论文提出一种描述和评估人工智能系统的语义框架,强调模型输出并非其所指向的事实或世界状态,而是经过工程化的表示。框架区分领域知识、参考来源与系统当前可用信息,并定义外推、无依据断言、来源与知识不匹配、过时来源及未经支持的工具使用等失败类型。
最近 24 小时暂无可用热度快照。