埃隆・马斯克(Elon Musk)旗下人工智能公司 xAI 正式发布最新大语言模型 Grok 4.1,并同步向 grok.com、𝕏 平台及 iOS / Android 应用全面推送。新版本在智能表现、创意能力及情感理解方面实现大幅升级,被官方视为 “面向真实世界场景的全面进化”。


性能大跃升:从第 33 名直冲榜首


Grok 4.1 在大型语言模型竞技场(LMArena)中取得突破性成绩,其深度思考版本(代号 quasarflux)以 1483 Elo 分数登顶文本能力排行榜,领先第二名达 31 分。

更令人关注的是,无需深度推理的即时响应版本也以 1465 Elo 排名第二,性能超越其他模型的 “全推理” 模式。相比前代排名第 33 位的 Grok 4,此次更新实现质的飞跃。

情商与创意能力显著提升
除了逻辑与推理性能,Grok 4.1 在 “软实力” 方面也全面强化:


- EQ-Bench3 情商测试:推理模式与非推理模式包揽前两名
- Creative Writing v3 创意写作测试:两种模式分别位列第二和第三,仅次于早期 GPT-5.1
这意味着 Grok 4.1 不仅能处理复杂任务,也能更自然地理解用户情绪,生成更具人性化、想象力的内容。
幻觉率大幅降低:更可靠的信息查询能力

xAI 表示,在训练后期特别强化了模型对真实世界信息查询任务的稳定性,显著减少事实性错误。新版本在评估中展现更低的 “幻觉” 率,使其在搜索、问答等应用场景中更精准可信。
全面向全平台用户推送

Grok 4.1 已向所有用户开放,无论通过 𝕏 平台、grok.com 或移动端 App,均可立即体验新模型带来的性能提升。




