近日,蚂蚁团队正式发布并且开源了 LLaDA2.2,全球第一个能正经做 Agent 任务的扩散语言模型。
先说什么叫「扩散」。现在大家用的 GPT、Claude、Kimi,生成方式是一个字一个字往外蹦。扩散模型不一样,一口气写一大段,再慢慢改好,天然更快。
但它一直有个死穴:改的时候,只能把 A 换成 B,不能删、不能插。就像打字机,一个字扣一个字,错了涂掉重打,但长度不能变。多写了一句废话,删不掉。写完后发现漏了关键信息,塞不进去。
日常聊天看不出来。一旦让模型写代码、调工具、跟外部系统打交道,马上崩。调工具写错了参数,没法删掉重写,只能原地继续改,越改越乱。
LLaDA2.2 修的就是这个死穴。修法出奇地简单。以前改文章只有两种操作:保持不动、或者原地替换。现在加了两种:删除、插入。
写多了,删掉。漏了什么,从中间撑开一个空位,补上。
为什么能删能插?背后借了一个古老的数学公式,是 1965 年一位苏联数学家发现的:任何两段话之间的差距,都可以用「改几个字 + 删几段 + 插几句」算清楚。LLaDA2.2 把这个公式塞进了生成过程,让模型每次改稿时自己算一算,我该删哪、该在哪补。
效果翻得很直接。同样的模型、同样的训练数据,只把「删」和「插」打开,代码任务得分从 35.8 跳到了 44.4。
打个比方。以前的扩散模型是打字机,一个字扣一个字,错了涂掉重打。LLaDA2.2 是手机备忘录,写到一半随时划掉一行、在中间补两句。能自己改自己了。
当然现在还远没到能跟 GPT 正面打的时候。所有测试都是蚂蚁自己跑的,没有第三方来验。换一家公司的模型能不能同样有效,也没人试过。扩散模型做 Agent 这件事,今天是第一次有人证明它能跑通,不是跑赢。
蚂蚁团队发布并开源LLaDA2.2全球⾸个⼤规模Agentic扩散模型AI Agent








