马斯克深夜放大招!Grok 4.7将超越所有模型,加入SpaceX专属数据
今天凌晨2点,马斯克又双叒叕在深夜放狠话了,并且冲上了热搜。Grok 4.7马上就要来了,性能比Grok 4.6强一大截,初步训练已经完成。
目前正在加入大量SpaceX公司的专有数据进行训练,预计将在3—4周内就能全部完成。
马斯克还特意强调,Grok 4.7将超越当前所有模型。
由于SpaceX训练数据的独特性和丰富性,如果其他模型在实际工程应用方面能比Grok 4.7更出色,会感到非常惊讶。
有意思的是,今天凌晨刚发布了Grok 4.6,一个月后Grok 4.7就来了,那这个4.6岂不是很尴尬,或者说4.6只是一个过渡模型。
不过AI领域的迭代速度是真滴快,已经都按周计算了~
对于马斯克这个狠话,网友表示,那岂不是所有人都能问火箭科学的问题了,而且SpaceX的数据也会在里面。
3到4周,希望它在3D空间推理和建模方面能比我目前用4.6测试下来的表现更出色。不过4.6仍然是很棒的快速干活主力!
每次刚觉得自己终于摸到门道了,结果又来个新版本更新。等我真把它彻底玩明白,估计连 17.0都出了
3—4周?这也太快了!
4.6感觉好多了,这玩意现在简直起飞,我敢打包票4.7 肯定更猛。
你们训练旗舰模型的速度也太惊人了!
太不可思议了,Elon!Grok 4.7 接入SpaceX 的数据,听起来简直绝了。我已经迫不及待想看看它到底有多强了。
AI的未来就在我们眼前一步步变成现实!感谢你再次突破极限!
不得不说,Grok 如果能真正打通 SpaceX 的航天数据,那确实是大模型领域一个非常硬核的差异化方向。
这种将前沿AI与实体航天工业深度结合的思路,估计又要引发一波关于AI落地场景的激烈讨论了。
刚发布的Grok 4.6
在唠唠马斯克在今天凌晨发布的最新模型Grok 4.6,咱们长话短说只挑重点的来。
Grok 4.6这次最大亮点之一就是加入了原生自我校验功能。
以往我们用AI做复杂工作,经常会遇到中间步骤出错,最后整体成果报废的情况,我们还要手动逐一排查问题,特别耗费时间。
现在Grok 4.6会自主完成自测、交叉核对和结果验证,确认每一步输出的内容准确无误后,才会推进下一个步骤。
这个改动,直接大幅减少了长流程工作里的逻辑错误、信息编造和代码报错问题,实用性直接拉满。
相比Grok 4.5,4.6在训练的时候也进行了大革新。
首先是训练数据的升级,官方专门筛选了大量高质量的专业数据,重点覆盖逻辑推理、高等数学、前沿工程理论这类高难度内容,让模型的底层思考能力变得更严谨。
同时还引入了海量真实的工业级工程数据,完整贴合软件开发的全流程,不再是单纯依赖理论数据训练
底层算法的微调,研发团队优化了训练核心组件,重新调整了损失函数的配比,很好解决了超长文本、长任务场景下容易出现的内容偏差问题。
还有一个很聪明的优化方式,团队利用前代模型自主生成了数百万条高质量推理样本,用来给新模型做微调训练,再结合多阶段强化学习优化,完美贴合开发者和企业的真实使用习惯。
测试数据方面,综合智能评分上,Grok 4.6拿到61分,相比前代的56分有大幅提升,已经和GPT-5.6 Sol Max持平,仅仅小幅落后于行业顶尖的Fable 5 Max。
在深度知识推理能力上,优势更明显,评分远超前代模型,同时超越了GPT-5.6 Sol Max,无限逼近头部旗舰模型的水平。
大家最关心的代码能力也有全面升级,在日常工程代码生成准确率、复杂拓展编程任务这两个维度,都比上一代有稳定提升,和两款顶尖竞品的差距微乎其微。
大型代码库修复能力的提升更是肉眼可见,相比前代提升也非常大。
除此之外,Grok 4.6还重新校准了模型的安全防护机制。随着模型能力越来越强,能完成的复杂工作越来越多,对应的安全边界也需要同步适配。
这次调整在开放创作的自由度和事实信息的准确性之间,找到了一个特别均衡的状态,既不会过度限制模型发挥,也能有效避免虚假信息输出。
从今天开始4.6已经全面上线了, Cursor已经完成内置接入,xAI自研的智能体开发平台也原生搭载了这款新模型,开发者可以通过官方API直接调用。
同时还适配了多个主流第三方平台,日常使用基本不用切换工具,兼容性特别好。
收费价格是每百万输入token为2美元,百万输出为6美元。还有一种快速版本,但价格是普通的两倍。免费用户也可以在Grok Build中试用了。
