2025年 7月 11日 下午8:57

Grok4成“宇宙最强模型”?AI竞赛进入“马斯克节奏”

  虽然马斯克本人一脸疲态,但他亲自坐镇,给Grok 4的噱头拉到顶配。

  “宇宙最强模型”“它比所有领域的人类博士都聪明,无一例外”“Grok 4还没发明新科学或新物理定律只是时间问题”“Grok 4解决代码问题,比Cursor更好用”……

  以上宣言,是马斯克为旗下AI公司xAI最新旗舰大模型Grok 4的定调。

  Grok 4也确实争气,在“人类最后的考试”(Humanity’s Last Exam)中,拿到了38.6%的准确率,超过了谷歌Gemini 2.5 Pro的21.6%和OpenAI o3的21%。多智能体版本Grok 4 Heavy拿到了44.4%,如果进一步使用工具辅助,则能达到50.7%。

  这背后,是“暴力计算美学”,xAI耗时6个月搭建起来的10万块H100 GPU超级算力中心正在给出回报,Grok 4的训练量是Grok 3的10倍,是Grok 2的100倍。

  回归商业世界的马斯克火力全开,接下来还计划 8 月推出代码模型,9 月上线多模态智能代理,10 月发布视频生成模型。

  据悉,Grok已经被配置在了特斯拉最新固件里,未来也将通过人形机器人与现实世界交互。

  AI大模型、自动驾驶、人形机器人商业航天,马斯克的AI帝国正在越来越宏大,节奏也更甚从前。

  Grok 4有多能打?

  在多个高难度基准测试中,Grok 4表现出色。

  马斯克在直播中强调,Grok 4在人文、数学、物理、工程等学科均达到博士以上水平,“比几乎所有学科的研究生更聪明”。

  推理能力刷新纪录。Grok 4 拿到历史高分的“人类最后的考试”,是一份被称为“AI 世界终极试炼”的测试合集,这份专门针对AI的考卷,覆盖了数学、化学、语言学、自然科学等一百多个学科,大模型在这份测试中无法依赖网络搜索,只能凭自己的理解和推理能力作答。

  能应对这份考卷的Grok 4,推理能力有大幅提升,可以减少对现有知识框架的依赖。

  除HLE测试领先外,Grok 4在GPQA(研究生级问答)中拿到了88.9%,在美国数学邀请赛(AIME25)中拿下满分,ARC-AGI-2测试中以16.2%得分登顶(超第二名Claude Opus 4近一倍)。

  商业场景的落地验证方面,在名为 Vending-Bench 的商业模拟任务中,Grok 4 也表现突出,经营自动售货机时平均净资产达到 4684.15 美元,是第二名的两倍,证明了长期规划和多步骤推理能力。

  值得注意的是,Grok 4的创新点在于“工具原生融合”架构。与多数模型后期接入工具不同,Grok 4在训练阶段嵌入了搜索、代码执行等工具,使其能灵活调用资源解决复杂问题。例如直播演示中,它通过检索学术论文、调用模拟工具,生成了黑洞碰撞的可视化动态模型。

  不过,业内人士认为,Grok 4 的强项主要集中在推理和复杂知识整合方面,而在代码、多模态、图像和视频生成等方面还有进步空间。

  “最贵”模型的想象空间

  xAI同步推出了行业最贵订阅计划:Super Grok Heavy月费高达300美元,较OpenAI顶级订阅贵50%。API定价同样激进,每百万token输入3美元、输出15美元。

  高定价背后其实是训练成本的陡增。Grok 4百倍于前代的训练量,依托10万块H100 GPU集群完成,xAI并未披露单次训练耗资,但马斯克提到的“我们快没有合适问题考验AI了”,侧面印证了模型能力已逼近当前测试极限。

  Grok 4的终极目标是与现实世界交互。马斯克透露,今年Grok 4还将融合有限元分析、流体动力学等工具,构建高精度物理模拟器(如黑洞模拟)。在他的规划中,Grok 4将通过Optimus(马斯克旗下的擎天柱)人形机器人连接现实,“让AI接受物理定律的最终检验”。另有消息显示,目前特斯拉最新固件已预埋Grok,未来或将作为车载语音助手及自动驾驶的“大脑”。

  “我们正站在智能大爆炸的开端。”马斯克表示,对AI的最终测试是现实世界,未来AI技术将会放到改进汽车或火箭等领域验证有效性。

  “睡在算力中心”的掌舵人归来

  从特斯拉Robotaxi(无人驾驶出租车)秀肌肉,到Grok 4的暴力美学,近10天,马斯克已经称霸舆论场两回,他正以标志性的激进节奏推进业务。

  马斯克所布局的自动驾驶、AI大模型、人形机器人商业航天,逐渐形成闭环。Grok大模型作为“大脑”,驱动特斯拉自动驾驶、Optimus机器人行动决策;特斯拉车辆与机器人反馈的真实场景数据,反哺模型迭代;其旗下SpaceX星链提供全球低延迟通信,支撑实时AI交互。

  OpenAI的ChatGPT-5还在酝酿中,目前AI军备竞赛进入“马斯克节奏”。马斯克的算力碾压、多场景捆绑,确实具有更宽广的应用想象力。

  但在AI大模型快速迭代的当下,有多少用户愿意为了300美元月费的Grok 4买单,还是未知数。

  高调背后也暗藏风险。Grok近期因发表反犹言论遭土耳其封禁、波兰政府投诉,迫使xAI紧急删除不当内容并调整审核策略。在“AI寻求真理”的路上,如何在开放性与安全性间平衡,不只是OpenAI 塞姆·奥特曼的难题,也是马斯克的。

  马斯克在今天的直播中说:“安全是最重要的事,我们需要确保AI是一个好AI。你可以把AI看作是超级天才的孩子,它最终会比你聪明,但我们仍然要灌输正确的价值观。”

(21世纪经济报道)

文章转载自 东方财富

spot_img

热点

快讯

特朗普宣布35%高关税施压加元,美元兑加元反弹至密集压力区间

特朗普对加征税“升级”,再施压加方尽快达成协议特朗普周四表示,美国将自8月1日起对来自加拿大的商品征收35%关税。他指出,此举是对加拿大此前“报复性关税”的回应,并批评加方在贸易谈判中“不具建设性”。目前,美国对加拿大钢铁和铝的50%关税仍在施行,加拿大是美国这两类金属的最大进口来源。特朗普还透露,欧盟将在“今天或明天”收到征税通知信,进一步表明其关税政策全面推进的趋势。“加拿大处于贸易谈判的弱势地位,尤其是其出口结构过度依赖美国市场。” ——据市场调查显示,多伦多经济智库NorthBay Strategies首席分析师Helen Murray指出市场担忧,这轮政策紧张将打击加拿大出口、企业信心及央行货币政策空间。美联储立场仍偏观望,美元依旧获得支撑美元整体维持强势,主要受益于美联储官员近期对降息持谨慎态度。芝加哥联储主席古尔斯比(Austan Goolsbee)表示,美联储的职责是确保就业与稳定价格,而非为了降低政府债务融资成本而贸然降息。与此同时,本周公布的6月17-18日联邦公开市场委员会(FOMC)会议纪要显示,多数决策者仍倾向“观望立场”,等待更多经济数据释放信号。“虽然通胀已明显回落,但决策层内部对于过早放松仍存在分歧。” ——据市场调查显示,华盛顿宏观研究机构Federal Horizon分析师Jason Berman指出从技术图形来看,美元兑加元在1.3640区域获得支撑后反弹,目前上行目标关注1.3735阻力位,突破后将有望挑战6月高点1.3770一带。若再次回落,下方支撑见于1.3650与1.3600区域。技术指标如MACD和RSI在小时图上转为温和看涨,显示短线仍有上行动能。编辑观点:美元兑加元短期走势主导因素仍为贸易政策与美元强势交替作用。加元因贸易依赖性强、经济对出口敏感,在此次美国单方面高关税措施下显得尤为脆弱。若加拿大政府未能迅速与美方达成“妥协性协议”,加元或继续承压;而美元在无强降息预期的支撑下,中短期仍有走强空间。 转载自 一期货

技术分析:现货黄金或测试3342美元阻力位

文章来源:汇通网 周五(7月11日)亚洲时段,现货黄金震荡走高,目前交投于3335美元/盎司附近。路透技术分析师指出,现货黄金可能测试每盎司 3342 美元的阻力位,突破该阻力位可能上涨至 3357 美元至 3374 美元的区间。预测分析显示,当前的上涨与之前自 3247 美元以来的上涨趋势密切相关。此次上涨很可能是该趋势的延续。乘着C浪,趋势可能延伸至3374美元,这是上通道所暗示的。支撑位在3328美元,跌破该支撑位可能导致价格跌至3300美元至3311美元区间。日线图显示,金价可能再次攀升至3361美元,目前已在3,306美元的支撑位附近企稳。若金价突破3361美元,趋势信号将转为看涨。最理想的情况是市场可能无法克服这一障碍,因为从...
spot_imgspot_img