Elon Musk表示,即将发布的Grok 4.7仍有进一步优化空间。[图片来源:Shutterstock]

Elon Musk表示,xAI原定推出但已延期的AI模型Grok 4.7,整体表现大致与Anthropic的Opus 5处于同一水平,但与Opus 5.1及OpenAI Astra相比仍有差距,多模态能力也仍需进一步优化。

据区块链媒体Cryptopolitan 14日(当地时间)报道,Elon Musk日前在X(原Twitter)发文称,Grok 4.7“整体上大致相当于Opus 5”,在某些方面更强,在另一些方面则相对落后。他同时承认,该模型的多模态表现还有待改进。

对于延期原因,Elon Musk解释称,Grok 4.7“还需要再打磨几天”。他认为,在强化学习阶段,模型可能因对回答长度惩罚过重,即便面对本可解决的高难度任务,也会出现“过早放弃”的情况。此外,模型对自身输出结果的复核能力也还不够严格。

Grok 4.7原计划于12日发布,随后宣布延期。根据已披露的信息,该模型参数规模约为2.1万亿,并据称引入了SpaceX的工程数据进行增强。若相关信息属实,Grok 4.7较参数规模约1.5万亿的Grok 4.6扩大约40%。不过,Grok 4.7的官方基准测试成绩及Token定价目前尚未公布,关于其“价格可能较竞品最多低10倍”的说法也仍未得到验证。

作为对比,Anthropic相关竞品的外部评测和价格信息已对外公开。报道提到,Opus 5.1的基准测试成绩与定价目前均已可查,其中在Terminal-Bench-Science上的得分为52.6%,定价为每百万输入Token 10美元、每百万输出Token 50美元。

除Grok 4.7外,Elon Musk还披露了后续产品路线图。他表示,Grok 4.8的参数规模为2.5万亿,正在基于xAI新的C++软件栈进行训练,预计将于本周内完成训练,并转入强化学习阶段。按其说法,Grok 4.8相较Grok 4.7将实现“显著改进”。

对于Grok 4.9,Elon Musk称,其表现有望达到OpenAI Astra和Anthropic相关系列模型的水平。他还表示,2.5万亿参数模型较现有2.1万亿参数模型更具优势。与此同时,他提到,旧版模型在基于JAX的训练过程中,曾在中途修正过部分错误。下一步,xAI还将借助改进后的内部训练软件和更精炼的数据,推进3万亿参数规模模型的训练。

在后续版本中,Elon Musk最看好的是Grok 5。他表示,Grok 5“也许会比任何模型都更强”,但最终表现仍有待观察。对于“某些能力最终会由哪一代模型实现”的提问,他回应称,“那会由Grok 5完成”。不过,Elon Musk并未透露Grok 5的具体发布时间,也未给出支持上述判断的明确依据。

目前,市场上可验证的xAI基准模型仍是Grok 4.6。相比之下,Elon Musk此次提到的主要对标对象——Opus 5.1和OpenAI Astra——均已公开,而Grok 4.7仍处于发布前的最后调整阶段。这意味着,Grok 4.7的实际竞争力仍需等到正式发布后,结合独立基准测试结果再作判断。

关键词

#xAI #Elon Musk #Grok 4.7 #Grok 4.8 #Grok 4.9 #Grok 5 #Anthropic #Opus 5 #OpenAI Astra #多模态能力
版权所有 © DigitalToday。未经授权禁止转载或传播。