马斯克预告Grok 4.6:1.5万亿参数下周发布,xAI与OpenAI算力军备赛再升级

2026年8月5日,在SpaceX 2026年Q2财报电话会议上,埃隆·马斯克宣布了一条令AI圈震动的消息:xAI将于下周正式发布总参数量达1.5万亿的Grok 4.6模型,并在3至4周后推出2.1万亿参数的Grok 4.7。这标志着大模型参数竞赛在经历短暂「质量优于规模」的反思后,重新回到算力与规模的正面对抗。

一、Grok 4.6核心信息一览

据马斯克在电话会议上的表述,Grok 4.6并非简单的参数堆叠,而是重点改进了两个训练范式:监督微调(SFT)强化学习(RL)。以下是已知的关键参数:

维度 Grok 4.6 Grok 4.7(预告)
总参数量 1.5万亿 2.1万亿
预计发布 下周(约8月11日) 3~4周后
训练重点 SFT + RL改进 规模扩展+推理增强
架构 稀疏MoE(推测) 稀疏MoE(推测)
训练算力 孟菲斯超级集群 待公布

二、为什么参数竞赛重新打响

2.1 从「缩放定律」到「质量优先」再到回归规模

2025年下半年,行业一度认为单纯的参数扩张已触及天花板,DeepSeek、Qwen等模型以更小参数实现接近旗舰性能,让市场相信「数据质量与训练算法比参数更重要」。然而2026年的事实给出了不同答案:

  • OpenAI Astra以可机器验证的Lean证明攻克10项数学难题,推理成本约2000美元,证明超大规模模型在科研级任务上不可替代。
  • 阿里Qwen3.8-Max以2.4万亿参数登顶Arena榜单仅次于Claude系列,编程与办公能力大幅提升。
  • DeepSeek-V4-FlashAgent能力暴涨6倍,编程成本仅0.14美元/百万Token。

这些案例说明:当模型能力逼近人类专家水平时,每一点提升都需要指数级的参数与算力投入。

2.2 xAI的算力底座

xAI位于美国田纳西州孟菲斯的超级计算集群是Grok系列快速迭代的基础。该集群以英伟达H100/H200 GPU为核心,马斯克曾表示目标是打造「全球最大AI训练集群」。Grok 4.6能在Astra发布仅一周后跟进,背后正是算力冗余的支撑。

三、Grok 4.6的技术看点

3.1 监督微调(SFT)的改进方向

Grok系列一直以「实时接入X平台数据」为差异化卖点。Grok 4.6在SFT阶段预计将强化以下能力:

  • 实时事实核查:利用X平台的实时信息流,降低模型幻觉率。
  • 多模态对齐:文本、图像、视频的统一表征空间训练。
  • 指令跟随精度:在复杂多步骤指令场景下的执行准确率。

3.2 强化学习(RL)的新范式

马斯克特别强调RL改进,这可能与以下技术趋势相关:

# 典型的大模型RL训练流程(简化示意)
import torch
from transformers import AutoModelForCausalLM

model = AutoModelForCausalLM.from_pretrained('xai/grok-4.5')

# 基于人类反馈的强化学习(RLHF)
# 奖励模型对生成结果打分
def reward_fn(response, reference):
    # 准确性、有用性、安全性多维评分
    accuracy = score_accuracy(response, reference)
    helpfulness = score_helpfulness(response)
    safety = score_safety(response)
    return 0.5 * accuracy + 0.3 * helpfulness + 0.2 * safety

# PPO策略优化
optimizer = torch.optim.AdamW(model.parameters(), lr=5e-7)
for batch in rl_dataset:
    rewards = [reward_fn(r, ref) for r, ref in batch]
    loss = ppo_loss(model, batch, rewards)
    loss.backward()
    optimizer.step()

Grok 4.6可能在RL阶段引入了过程奖励模型(PRM),即不仅对最终结果打分,还对中间推理步骤逐步评估,这与OpenAI o系列模型的思路一致。

四、xAI vs OpenAI:算力军备赛对比

对比维度 xAI OpenAI
旗舰模型 Grok 4.6(1.5万亿) Astra(未公布参数)
差异化 实时X数据接入 科研级数学推理
算力集群 孟菲斯超级集群 微软Azure+自建
开源策略 部分开源(Grok权重曾开源) 闭源
API定价 较低(X Premium用户免费) 较高

五、对开发者的影响

Grok 4.6发布后,开发者最关心的三个问题是:

  1. API可用性:预计发布同时开放API,定价可能延续Grok 4.5的每百万Token输入5美元、输出15美元策略,但实际以官方公告为准。
  2. 开源可能:xAI曾在2024年开源Grok-1权重,Grok 4.6是否延续开源传统值得关注。若开源,将成为继DeepSeek、Qwen之后又一万亿级开源选择。
  3. X平台集成:Grok深度集成X生态,实时数据能力对新闻聚合、舆情分析、金融研究等场景具有独特价值。

六、总结与展望

Grok 4.6的发布预示着2026年下半年大模型竞争将更加激烈。从OpenAI Astra的数学突破、阿里Qwen3.8-Max的开源宣言,到xAI的参数跃迁,三家头部公司选择了不同路径:OpenAI押注推理深度,阿里押注开源生态,xAI押注实时数据与规模。

对普通用户而言,竞争的直接红利是更强的能力与更低的成本。DeepSeek-V4-Flash已将编程成本压至0.14美元/百万Token,Grok 4.6若延续低价策略,将进一步推动AI能力普惠化。建议开发者持续关注8月中旬的官方发布,提前评估API迁移成本。

原文链接:https://www.jikeyum.com/1039.html,转载请注明出处。
0

评论0

显示验证码
没有账号?注册  忘记密码?