论文提出 MAAC,将文本 AI 评估从结果指标扩展到过程诊断,覆盖认知负荷、工具执行、记忆整合、幻觉控制等九个维度。框架借鉴 Marr、Baddeley 与 Sweller 等理论,并以五项理论分析论证覆盖性、非冗余性及可检验性,但尚未提供真实模型上的实证验证。
最近 24 小时暂无可用热度快照。