百度ERNIE-5.0-0110登顶LMArena文本榜国内第一,全球第八
百度官方 1 月 15 日称,ERNIE-5.0-0110以 1460 分位列文本榜国内第一、全球第八,数学榜全球第二;该版本已不再标注“Preview”。
AI解读:这条新闻对普通用户和开发者意味着:百度文心大模型的最新版本ERNIE-5.0-0110在一个第三方竞技场——LMArena——上拿到了中文模型里的最高文本分数,全球排第八。LMArena不是单一指标测试,它通过匿名盲测让用户投票,所以这个排名代表的是“人类觉得谁的回答更好”,而不是厂商自己报的数。数学榜全球第二,仅次于OpenAI的GPT-5.2-High,说明它在推理类任务上确实能打。对需要选模型的人来说,这给了个第三方参考点:如果文本质量和数学能力是你关心的,ERNIE-5.0-0110是当前值得纳入对比的国产选项。但注意两点:一是排名只覆盖文本和数学,不涉及多模态、代码或价格;二是官方没公布具体分项测试样本,竞技场结果有波动,所以理性做法是去LMArena看实时榜单或直接用API测试自己的场景,而不是把单一榜单当成最终结论。
百度官方 1 月 15 日宣布,文心大模型ERNIE-5.0-0110在LMArena最新公布的榜单中以 1460 分位列文本榜国内第一、全球第八,并称在同榜单中超越GPT-5.1-High、Gemini-2.5-Pro等多款国际主流模型。
百度官方还称,ERNIE-5.0-0110在LMArena数学能力排行榜中位列全球第二,仅次于GPT-5.2-High,并强调该版本已不再标注“Preview”,意味着预览阶段已完成。