Google DeepMind·· 2026-06-11精选AI 评分78
Google DeepMind 发布开源实验模型 DiffusionGemma,GPU 上文本生成速度最高提升 4 倍
DiffusionGemma: 4x faster text generation
AI 导读
Google DeepMind 发布开源实验模型 DiffusionGemma,这是一个 26B 参数的 MoE 模型,通过文本扩散技术并行生成整块文本,在专用 GPU 上推理速度最高提升 4 倍,单张 NVIDIA H100 上每秒可生成 1000+ token。
推荐理由
原文给出了速度、参数量和硬件门槛等关键数字,读者可以据此判断它适合哪些本地交互场景。
来源:Google DeepMind · deepmind.google