论文提出可执行基准 SeGaBench,包含 100 个合成案例和 20 个源代码案例,用于测试 LLM 能否从异构 C/C++ 上下文恢复编译器表示中缺失的语义,并生成保持契约的优化产物。摘要称最强模型的正确响应率为 94.8%,83.3% 的响应达到至少 1.05 倍加速,但通常仍未追平 oracle。
最近 24 小时暂无可用热度快照。