
谷歌发布开源AI模型DiffusionGemma:文本扩散机制加速推理
谷歌推出基于文本扩散机制的AI模型DiffusionGemma,本地推理速度提升4倍,支持迭代优化,采样速度高达1479 tokens/秒。
模型介绍
谷歌近期发布了基于文本扩散机制的全新开源AI模型——DiffusionGemma。与自回归模型如GPT、Gemini不同,DiffusionGemma在本地推理速度上实现了显著提升。
技术优势
DiffusionGemma通过从噪声中逐步去噪的方式并行处理所有Token,优化整体输出质量,并在本地低带宽计算环境下展现出显著的推理速度优势。

性能表现
- 代码生成:LiveCodeBench 达 30.9%,BigCodeBench 达 45.4%,HumanEval 达 89.6%。
- 数学推理:在 AIME 2025 基准中取得 23.3%,超越对比模型的 20.0%。
硬件加速
DiffusionGemma的扩散设计能充分发挥GPU Tensor Core的并行计算能力,在单块H100 GPU上生成速度达1000 tokens/秒。
下载与开源
DiffusionGemma以Apache 2.0许可证在Hugging Face开源。