
xAI 发布 Grok 4.6,以更低的成本触及智能前沿
xAI 正式发布了其新旗舰人工智能模型 Grok 4.6,该模型在人工智能分析指数中获得 61 分。此次发布使 xAI 重新回到与 OpenAI 的 GPT-5.6 Sol 以及 Anthropic 的领先模型并驾齐驱的智能前沿。与以往严重依赖扩大基础模型规模的上一代模型不同,Grok 4.6 的性能提升主要通过先进的后期训练实现,包括精炼的监督微调和对代理任务的强化学习。它保留了 Grok 4.5 的 1.5 万亿参数 V9 基础,同时显著提升了多轮对话执行和工具使用能力。独立评估显示,Grok 4.6 在 GDPval-AA v2 上获得了 1,753 的 Elo 分数,反映了其在现实世界代理知识工作中的强大能力。它还在 tau-cube 银行评估中获得了 50.7% 的得分,并在 Terminal-Bench v2.1 的基于终端的软件任务中获得了 88.4% 的得分。该模型支持 500,000 个 token 的上下文窗口,并接受文本和图像输入。尽管缩小了与顶级竞争对手的智能差距,xAI 仍将每百万输入 token 的价格维持在 2.00...








