MentalThink提出一种面向多模态大模型的视觉符号推理范式,让模型生成、渲染并解读SVG代码,把空间假设外化为可执行、可检查的中间表示。方法结合SVG语法对齐的监督微调与鼓励反复检查、修订和完善的多轮强化学习,在VSIBench和MindCube上分别达到55.1%和76.0%。
最近 24 小时暂无可用热度快照。