谷歌发布开源AI模型DiffusionGemma:文本扩散机制加速推理

谷歌推出基于文本扩散机制的AI模型DiffusionGemma,本地推理速度提升4倍,支持迭代优化,采样速度高达1479 tokens/秒。

16效率工具AI模型文本扩散推理速度开源

模型介绍

谷歌近期发布了基于文本扩散机制的全新开源AI模型——DiffusionGemma。与自回归模型如GPT、Gemini不同,DiffusionGemma在本地推理速度上实现了显著提升。

技术优势

DiffusionGemma通过从噪声中逐步去噪的方式并行处理所有Token,优化整体输出质量,并在本地低带宽计算环境下展现出显著的推理速度优势。

谷歌发布 DiffusionGemma 开源模型:基于文本扩散机制,本地推理速度飙升 4 倍插图

性能表现

  • 代码生成:LiveCodeBench 达 30.9%,BigCodeBench 达 45.4%,HumanEval 达 89.6%。
  • 数学推理:在 AIME 2025 基准中取得 23.3%,超越对比模型的 20.0%。

硬件加速

DiffusionGemma的扩散设计能充分发挥GPU Tensor Core的并行计算能力,在单块H100 GPU上生成速度达1000 tokens/秒。

下载与开源

DiffusionGemma以Apache 2.0许可证在Hugging Face开源。