Google 提出实验性开放权重语言模型 DiffusionGemma,将 Gemma 4 混合专家模型改造成离散扩散模型,通过每轮并行细化 256 个 token,缓解自回归解码的串行瓶颈。模型总参数 252 亿、激活参数 38 亿,在单张 NVIDIA H100 上约每秒生成 1,500 个 token,训练 token 预算少于原始模型的 10%。
最近 24 小时暂无可用热度快照。