百度发布文心大模型ERNIE-5.0-Preview-1103,称登顶LMArena文本榜单前 20
百度ERNIE团队发布新版文心大模型,在对抗性文本竞技场Text Arena中排名前 20,软件与IT领域得分与GPT-5.1-high持平。
AI解读:ERNIE-5.0-Preview-1103是百度文心大模型的一次重要迭代。它最大变化在于采用“原生全模态”设计——从训练起就混合语言、图像、视频和音频数据,而非像许多模型那样先训练文本再加视觉。这使得它在理解和生成多种内容时可以共享同一套特征,理论上更协调。技术上,它使用超稀疏混合专家(MoE)架构,总参数超过 2.4 万亿,但推理时只激活不到 3% 的参数,从而在保持能力的同时降低计算成本。在LMArena文本竞技场中,其软件与IT服务得分为 1471,和GPT-5.1-high持平;编程得分 1464,相当于chat-gpt-4o。对开发者而言,这意味着在中文环境和全模态任务上多了一个选择;但实际效果仍需通过公开API或演示验证。当前评测主要来自百度官方声明,独立社区评价还需时间积累。
百度ERNIE团队于 2025 年 11 月 3 日(基于版本号推测)发布文心大模型最新版ERNIE-5.0-Preview-1103,并宣布其在LMArena文本竞技场(Text Arena)中排名前 20。
竞技场表现
据百度ERNIE官方博客消息,该版本在Text Arena中位居前 20 名。在软件与IT服务领域,ERNIE-5.0-Preview-1103获得 1471 分,百度称这与GPT-5.1-high持平;在编程领域获得 1464 分,百度称与chat-gpt-4o并驾齐驱。
模型架构与能力声明
百度称,文心大模型 5.0 是新一代原生全模态大模型,从训练开始便融合语言、图像、视频、音频等多模态数据,支持文、图、视、音联合输入输出。百度称其在 40 余项权威基准的综合评测中,语言与多模态理解能力与Gemini-2.5-Pro、GPT-5-High等模型持平,图像与视频生成能力与垂直领域专精模型相当。
- 总参数规模超过 2.4 万亿,激活参数比例低于 3%。
- 采用自回归统一架构,对不同模态训练目标进行离散化建模。
- 依托飞桨深度学习框架,采用超稀疏混合专家(MoE)架构。
智能体能力
百度表示,该模型基于大规模工具环境合成长程任务轨迹数据,采用基于思维链和行动链的端到端多轮强化学习训练,提升了智能体和工具调用能力。