DiffuSpace短期内获数亿人民币融资,经纬、顺为、君联押注扩散语言模型
近日,扩散智能DiffuSpace连续完成两轮融资,总金额数亿人民币,创全球扩散语言模型(dLLM)最大规模融资纪录,由经纬创投、顺为资本、君联资本联合领投,中科创星、华为哈勃、地平线等跟投。
扩散智能DiffuSpace致力于探索以扩散语言模型为核心的下一代基座模型,本轮融资将主要用于模型训练、垂直场景适配与基础设施研发。据悉,DiffuSpace正在推进新一代更大参数规模dLLM的训练,并计划于近期发布并开源。
扩散智能DiffuSpace由港大NLP实验室联合主管孔令鹏教授及其博士生龚珊三、叶佳成联合创立,核心团队长期深耕扩散语言模型研究,是全球最早探索该技术路线的团队之一,并在“条件生成、离散信号建模、Scaling”三大dLLM核心问题上均有全球领先突破。成员均来自清华、北大、港大、CMU等顶尖高校及头部模型团队。2022年,团队推出DiffuSeq,开创了扩散模型处理序列到序列文本生成的技术路径;2025年,团队推出的Dream 7B模型首次全面超越同参数规模的自回归模型,并在规划能力上比肩671B的DeepSeek V3。
2026年以来,dLLM在技术突破、产业关注和资本热度等方面持续升温。2026年前8个月,相关论文总数已达2025年全年的2.4倍。Google、Inception、蚂蚁集团等科技企业也在持续加码这一方向:Google已推出文本扩散模型Gemini Diffusion,美国dLLM公司Inception推出Mercury系列通用模型,并获得NVIDIA加速计算团队公开关注;蚂蚁集团等模型团队也陆续推出相关模型。随着更多头部科技公司和创业团队布局这一方向,扩散语言模型正从前沿研究加速走向工程化验证与应用探索。
近期报道显示,DiffuSpace与亚洲智能体计算平台公司Acrab已达成合作,通过dLLM的并行生成与全局建模能力,端侧Agent运行速度可提升5倍。基于此次合作,双方将继续加速推进扩散语言模型在 AI PC、智能汽车、机器人及智能家居等场景的落地。
打造下一代通用模型,扩散语言模型进入Scaling加速期
近年来,扩散语言模型(dLLM)被视为下一代通用人工智能基础模型的重要方向之一。
扩散语言模型拥有更通用的内容生成范式。不同于Claude、GPT等主流自回归模型「从左往右」的生成范式,dLLM可进行全局生成和并行解码,具备更强逻辑规划、全局一致与多模态融合能力,在特定场景下实现5至10倍推理加速,并在规划、复杂推理等能力上超越同规模自回归模型。
相比自回归模型,扩散语言模型的生成范式具备三项核心特点:
· 可逆修正:自回归模型一旦生成,无法回溯修改前文,只能在后文补充纠正;dLLM则可在生成过程中反复调整任意位置内容,提升内容一致性、减少错误生成。
· 全局求解:生成任意位置均可读取全部上下文,例如,可结合第50行与第200行内容共同求解,实现更强的全局规划与跨段协同能力。
· 柔性计算:动态分配计算资源,简单内容少计算、复杂内容多计算,在生成速度、计算成本与回答质量之间灵活平衡。
在具身智能、智能汽车、AI PC等Agent与多模态场景中,扩散语言模型同样具备优势。相比逐步生成,其能够对更长的动作序列、多模态输入以及多个并行任务进行整体建模,并在生成过程中动态调整。这一机制使dLLM更适合处理连续动作规划、车载任务交互、端侧Agent并行等场景,并在响应速度、任务一致性和全局协调能力等方面实现提升。
从源头创新到持续领先,DiffuSpace四年押注dLLM
资料显示,DiffuSpace核心成员自2022年起投入dLLM研究,先后推出DiffuSeq、RDM、DiffuLLaMA等研究成果,并研发出全球代表性dLLM之一Dream 7B,2025年ICML相关演讲中,Dream 7B与Google Gemini Diffusion、Inception Mercury被并列为三大代表性dLLM。
在这条新技术路线上,DiffuSpace并非沿着既有路径追赶,而是从源头创新。2022年,团队提出DiffuSeq,率先将扩散模型系统引入序列到序列条件文本生成(Seq2Seq),第一次让扩散模型能够完成对话、改写、问句生成、文本简化等真实应用。该成果后被ICLR 2023收录,成为早期条件式文本扩散领域的代表性工作。
2025年,团队推出 Dream 7B模型,打通dLLM的Scaling路径,该模型在数学、代码、规划等任务上全面超过同规模的自回归模型,部分指标甚至超过DeepSeek V3(671B),已在Hugging Face上获得超过250万下载量。基于Dream 7B,团队又陆续推出视觉语言模型Dream-VL、视觉-语言-行动模型Dream-VLA、DreamOn等垂类模型,进一步验证dLLM在多模态、Agent及具身智能等场景中的应用潜力。
2026年5月,DiffuSpace正式创立,并落地深圳,迈出了从实验室走向规模化训练的第一步。从DiffuSeq到Dream 7B,经过四年持续研发,团队已形成覆盖算法、数据、训练和推理的dLLM全栈能力。其所在的大湾区集聚了芯片、智能汽车、机器人、智能终端等产业资源,为基础模型与硬件、终端企业的协同提供了产业土壤。目前,DiffuSpace正在推进新一代更大参数规模模型训练。
猜你喜欢
DiffuSpace短期内获数亿人民币融资,经纬、顺为、君联押注扩散语言模型
DiffuSpace正在推进新一代更大参数规模dLLM的训练,并计划于近期发布并开源。

猎云网



