首页 > AI > AI快讯> 正文

免费开放!马斯克Grok 4.1多维度升级,AI王座之争再掀波澜

佚名 整合编辑:太平洋科技 发布于:2025-12-19 16:08
由华为云驱动

近日,马斯克旗下xAI推出聊天机器人Grok的最新版本Grok 4.1,全平台免费开放。它响应快、幻觉率低、情商高、创意写作能力强,测试成绩出色,上下文窗口大。其采用新“训练思路”,进步显著。Grok已集成到特斯拉,交互更智能。在激烈竞争中,Grok 4.1虽优异,但榜首之位能否稳固未知。

AI赛道竞争愈发激烈,马斯克旗下xAI推出聊天机器人Grok的最新版本Grok 4.1。该版本全平台免费开放,上线后直接在多个权威榜单上名列前茅。马斯克表示,与前代产品相比,用户能“明显感受到响应速度与回答质量的提升”。

Grok 4.1此次一共推出两大版本,分别是Grok 4.1 Thinking和Grok 4.1。在LMArena排行榜上,Grok 4.1 Thinking取得了1483 Elo的成绩,加冕全球大模型之王,比Gemini 2.5 Pro高出整整31分。即便是非推理模式的Grok 4.1,也直接进入榜单第二名。

Grok 4.1主要针对用户使用AI时遇到的痛点进行升级。

  • 速度方面,它分为两种模式,日常聊天可使用“快速模式”,无需等待思考步骤,直接秒回;处理复杂问题时开启“思考模式”,步步推理也不会拖沓,无论是闲聊还是查资料都不耽误。
  • 在“幻觉”问题上,AI编假信息一直让人困扰,而Grok 4.1把幻觉率从12.09%降到了4.22%,减少近三倍,查数据、写报告时无需反复核对事实。
  • 在情商和文采上,以往的AI安慰人如同念模板,现在Grok 4.1能捕捉到用户的情绪细节。比如用户说“想猫想得心碎”,它会提到“猫咪睡过的角落”“期待听到的叫声”等感人的点,还会主动让用户分享猫咪的故事,并非冷冰冰的敷衍。在创意写作评分上,它直接提高了600点,写段子、故事都有模有样,风格也十分统一。

Grok 4.1的测试成绩相当出色。

  • 在国际公认的LMSYS Arena盲测平台上,“思考模式”获得1483 Elo的高分,在所有公开模型中排名第一;即便不开启思考模式,也能排到第二,比很多竞品的全功能版本还要强。
  • 在情商测试EQ - Bench中,它也直接登顶,分数比上一版提升了100多。

上线前,xAI进行了半个月的“静默测试”,在未宣传的情况下悄悄给部分用户使用,结果在盲测里大家对它的偏好率高达64.78%,远超旧版本。而且,它的上下文窗口最高支持256000 tokens,Fast模式下甚至能扩展到200万,阅读长篇报告、写万字文章或长时间聊天,都能保持内容的连贯性。

此次xAI十分慷慨,没有设置付费解锁,所有用户都能直接使用。无论是网页端(grok.com)、X平台,还是iOS、Android的APP,包括免费用户都能使用完整功能,默认即为Grok 4.1版本,无需额外花钱升级。

此外,Grok已经集成到特斯拉车型中,升级到4.1后,开车时使用语音助手交互更顺畅,查路线、调空调、聊日常都更加智能,就像给车添加了一个“超强大脑”。

Grok 4.1之所以能有如此大的进步,关键不在于增加训练数据,而是采用了新的“训练思路”。xAI运用“前沿推理模型”作为“奖励模型”,让Grok能够自行评估回答的好坏,并快速调整优化,不再依赖大量人工标注。这样不仅提高了事实准确性,还能精准控制说话的风格和语气,长对话也不会“崩人设”。

目前,Grok 4.1已在网页端和iOS、Android中免费上线,处于beta版本。在创意表达、情绪交流和协作互动上表现出色,能精准捕捉细微意图,让对话更自然、更有温度。其整体人格更加一致,既保留了上一代犀利、可靠的智能表现,又增添了几分亲和力。

在大模型竞争激烈的当下,OpenAI刚更新产品线,谷歌也即将发布新作,Grok 4.1虽目前表现优异,但榜首之位是否会再次易主,一切仍是未知数。

佚名

甄选好物

推荐 手机 笔记本 影像 硬件 家居 商用 企业 出行 未来
二维码 回到顶部