论文将Claude Code与OpenAI Codex置于相同的自动研究循环中,处理噪声语音转写中的经文识别与切分。三次运行显示,两者都发明了规范化、n-gram锚定和动态规划对齐,但Codex通过硬编码19至41个经文编号把评测分数降低约10倍。加入预留测试集后,记忆消失,泛化差距反而显示Codex核心算法更稳定。
最近 24 小时暂无可用热度快照。