2026-09-15 01:21:10
icon loading...

马斯克承认Grok 4.7落后于Anthropic和OpenAI的最新模型;承诺Grok 5将实现AGI

摘要
马斯克对xAI延迟发布的Grok 4.7模型预期降温在Grok 4.7正式发布之前,埃隆·马斯克(Elon Musk)已对该模型的预期进行了适度调整。他在社交媒体X上承认,该模型在与Anthropic的Opus 5.0进行对比时表现更为有利,而相较于更新版本的Opus 5.1、OpenAI的Fable甚至Astra模型

马斯克对xAI延迟发布的Grok 4.7模型预期降温

在Grok 4.7正式发布之前,埃隆·马斯克(Elon Musk)已对该模型的预期进行了适度调整。他在社交媒体X上承认,该模型在与Anthropic的Opus 5.0进行对比时表现更为有利,而相较于更新版本的Opus 5.1、OpenAI的Fable甚至Astra模型,其竞争力则稍逊一筹。此外,马斯克还指出,多模态性能仍有待提升。这些坦诚的评价与其通常在产品上市前所营造的热度形成了鲜明反差。

Grok 4.7的具体表现如何?

针对外界关于Grok 4.7与竞品对比的疑问,马斯克写道:“它应与Opus 5.0大致持平,而非Opus 5.1。”这位SpaceX首席执行官补充称,该模型在某些方面更优,而在其他方面则稍弱。

马斯克于周五解释道,Grok 4.7还需要“几天的时间进行训练”,因为团队可能在强化学习过程中对响应长度施加了过重的惩罚。结果导致新模型“过早放弃那些本可完成的困难任务”,且其自我复核能力尚未达到要求水平。

Grok 4.7原定于9月12日发布,据报道是一个拥有约2.1万亿参数的模型,并辅以SpaceX的工程数据。如果这些报道属实,最新模型的规模将比Grok 4.6扩大40%,后者参数约为1.5万亿。

第三方评估显示,Anthropic的Claude Fable 5.1在Terminal-Bench-Science测试中得分达52.6%,其公开定价为每百万输入令牌10美元,每百万输出令牌50美元。相比之下,尚未发布的Grok 4.7尚无确认的基准测试分数或令牌定价。截至目前,关于其成本可能比竞品低10倍的说法仍未得到证实。

马斯克已承诺实现AGI

马斯克并未花费太多时间便回归了其雄心勃勃的发布计划,勾勒出了紧随尚未发布的4.7模型之后的快速迭代序列。

他表示,Grok 4.8是一个拥有2.5万亿参数的模型,基于xAI新的C++软件栈进行训练,将于本周完成训练并开始强化学习。他称这相比4.7版本是“显著的改进”。

在此基础上,马斯克声称Grok 4.9可能达到“Astra/Fable级别”,这是指代OpenAI的GPT-6 Astra和Anthropic的Fable系列。他将当前2.5万亿参数的模型描述为优于早期使用Jax训练的2.1万亿版本,后者曾出现“仅在运行中途才能纠正的错误”,并指向即将推出的3万亿参数版本,该版本将配备升级的内部训练软件和更清洁的数据。

最大的宣称留给了阶梯顶端。马斯克表示,Grok 5“可能优于任何现有模型”,但也谨慎地补充道“我们拭目以待”。在回复另一位用户关于何种模型能提供特定能力的提问时,他只回答:“那将是Grok 5。”

马斯克未提供该模型的发布日期,除断言外也未提供任何证据。目前,可衡量的基准仍停留在Grok 4.6,而马斯克本人设定为标杆的Opus 5.1和OpenAI的Astra已进入市场,Grok 4.7却仍在等待发布。

声明:文章不代表币圈网观点及立场,不构成本平台任何投资建议。投资决策需建立在独立思考之上,本文内容仅供参考,风险自担!转载请注明出处!侵权必究!
币圈快讯
查看更多
回顶部