Google 在 I/O 2026 前更新 Gemini app,新增 Gemini Spark、Gemini 3.5 Flash 与 Gemini Omni,重点强化主动式任务处理…
DiffusionGemma:文本生成速度提高 4 倍
这篇内容主要讲什么
今天,我们将介绍 DiffusionGemma,这是一种实验性开放模型,用于探索文本扩散,这是一种异常快速的文本生成方法。这个 26B 专家混合 (MoE) 模型在 Apache 2.0 许可证下发布,超越了典型自回归大型语言模型 (LLM) 的逐个令牌的顺序处理。相反,它同时生成整个文本块,在 GPU 上生成文本的速度提高了 4 倍。
- 适合先看摘要,再继续查看版本变化、背景和细节
- 发布时间:2026年6月11日
- 作者:编辑部
文章摘要
今天,我们将介绍 DiffusionGemma,这是一种实验性开放模型,用于探索文本扩散,这是一种异常快速的文本生成方法。这个 26B 专家混合 (MoE) 模型在 Apache 2.0 许可证下发布,超越了典型自回归大型语言模型 (LLM) 的逐个令牌的顺序处理。相反,它同时生成整个文本块,在 GPU 上生成文本的速度提高了 4 倍。
今天,我们将介绍 DiffusionGemma,这是一种实验性开放模型,用于探索文本扩散,这是一种异常快速的文本生成方法。 这个 26B 专家混合 (MoE) 模型在 Apache 2.0 许可证下发布,超越了典型自回归大型语言模型 (LLM) 的逐个令牌的顺序处理。相反,它同时生成整个文本块,在 GPU 上生成文本的速度提高了 4 倍。 DiffusionGemma 基于 Gemma 4 系列行业领先的每参数智能和尖端的 Gemin…
继续阅读相关文章
Google Search 在 I/O 2026 带来 AI agents、多模态输入和更深层的搜索交互更新,继续把搜索产品做成可执行任务入口。
[中国,上海,2026年6月8日] 6月5日,华为云 INSPIRE 2026 在上海西岸国际会展中心开幕。会上,华为云正式提出 Agentic Infra 新范式,并发布一系列 A…
· 诺基亚 NSP 增加了一个代理人工智能框架,使运营商能够部署基于实时、准确网络视图的人工智能代理,使他们能够基于可信数据进行推理,并在运营商定义的策略和安全边界内采取指导性、可解…
相关专题与 FAQ
暂无内容