Grok 4.7 泄露:下周即将发布了超越GPT-6 Astra

最近关于 xAI 下一代模型 Grok 4.7 的消息开始多了起来。

如果目前流出的信息属实,那么 Grok 4.7 可能不只是 Grok 4.6 的一次常规升级,而是 xAI 准备拿来正面挑战 OpenAI 下一代旗舰模型 GPT-6 Astra 的重要版本。

目前最受关注的一项爆料,是 Grok 4.7 的模型规模可能达到约 2.1T 参数。

相比 Grok 4.6,据称新模型的参数规模增加了超过 600B。单看参数量当然不能直接决定模型能力,但如果训练数据、后训练以及推理架构同步升级,这种体量上的提升依然值得关注。

更重要的是,有消息称 Grok 4.7 的初始训练阶段已经完成,目前 xAI 正在进行后续补充训练和能力强化。

这一次训练数据中还有一个比较特别的地方:SpaceX。

据传 xAI 在 Grok 4.7 的后训练阶段加入了大量来自 SpaceX 的相关数据。考虑到 SpaceX 涉及航天工程、物理、软件、自动化控制以及复杂工程系统,这类高质量专业数据如果真正参与训练,可能会对 Grok 在科学推理、工程问题和复杂任务处理方面产生一定帮助。

当然,这并不意味着模型加入 SpaceX 数据之后就一定会在所有领域实现质变,但至少可以看出,xAI 正在尝试通过更专业的数据进一步强化 Grok 的技术能力,而不只是继续扩大通用互联网数据规模。

从目前的爆料来看,Grok 4.7 主要可能会加强三个方向。

图片[1]-Grok 4.7 泄露:下周即将发布了超越GPT-6 Astra-vps

第一个是推理能力。

现在旗舰模型之间的竞争,早就不只是“能不能回答问题”,而是能不能连续完成多步推理、分析复杂条件,并且在长任务中保持稳定。

如果 Grok 4.7 的训练规模和后训练强度确实明显高于上一代,那么复杂推理能力很可能会成为这次升级的重点。

第二个是编程。

代码能力已经成为各家模型竞争最激烈的领域之一。

从代码生成、Bug 修复,到理解大型项目,再到直接调用工具修改代码库,现在的竞争方向已经逐渐从“写一段代码”变成“能不能真正完成一个开发任务”。

因此,Grok 4.7 如果想正面挑战 OpenAI,Coding 基本不可能缺席。

第三个,也是更值得关注的方向,就是 Agent,也就是代理能力。

未来的大模型不只是聊天,而是接收一个目标之后,自己拆解任务、调用工具、浏览网页、运行代码,甚至连续执行几十个步骤。

如果 Grok 4.7 在 Agent 能力上真的出现明显提升,那么它和 GPT 系列之间的竞争就会从单纯的模型能力,进一步延伸到真正的 AI 工作流。

不过,相比参数和跑分,我反而觉得 Grok 4.7 最大的变量可能是价格。

目前流出的说法是,Grok 4.7 的使用成本有可能只有 GPT-6 Astra 的十分之一左右。

如果最后真的能够做到接近甚至超过 GPT-6 Astra 的能力,同时把 API 或推理成本压低一个数量级,那么影响就会非常大。

因为对于普通用户来说,模型排行榜上的几分差距可能并不明显,但对于每天调用几百万、几千万甚至上亿 Token 的开发者和企业来说,成本可能比单项 Benchmark 更重要。

这也是 xAI 最有机会制造差异化的地方。

一个能力达到顶级水平,同时价格足够低的模型,很可能比单纯拿下几个排行榜第一更有竞争力。

至于标题里最关键的问题:

Grok 4.7 到底能不能击败 GPT-6 Astra?

现在显然还不能下结论。

一方面,目前很多 Grok 4.7 的参数、训练数据和性能信息仍然属于爆料阶段;另一方面,GPT-6 Astra 本身最终会达到什么水平,同样存在很大的不确定性。

但可以确定的是,大模型之间的竞争已经越来越激烈。

以前大家讨论的是 GPT 有没有对手,现在真正需要看的可能已经变成:同样的模型能力,谁能做到更快、更便宜,以及谁能够真正替用户完成工作。

如果 Grok 4.7 最终真的做到 2.1T 级别模型规模,并在推理、Coding 和 Agent 三个方向同时升级,再配合明显低于 OpenAI 的价格,那么它确实可能成为 GPT-6 Astra 最值得关注的竞争对手之一。

至于最终谁更强,还是要等正式模型发布之后,用真实测试结果说话。

© 版权声明
THE END
喜欢就支持一下吧
点赞7 分享
评论 抢沙发

请登录后发表评论

    暂无评论内容