xAI 正式发布了其新旗舰人工智能模型 Grok 4.6,该模型在人工智能分析指数中获得 61 分。此次发布使 xAI 重新回到与 OpenAI 的 GPT-5.6 Sol 以及 Anthropic 的领先模型并驾齐驱的智能前沿。与以往严重依赖扩大基础模型规模的上一代模型不同,Grok 4.6 的性能提升主要通过先进的后期训练实现,包括精炼的监督微调和对代理任务的强化学习。它保留了 Grok 4.5 的 1.5 万亿参数 V9 基础,同时显著提升了多轮对话执行和工具使用能力。独立评估显示,Grok 4.6 在 GDPval-AA v2 上获得了 1,753 的 Elo 分数,反映了其在现实世界代理知识工作中的强大能力。它还在 tau-cube 银行评估中获得了 50.7% 的得分,并在 Terminal-Bench v2.1 的基于终端的软件任务中获得了 88.4% 的得分。该模型支持 500,000 个 token 的上下文窗口,并接受文本和图像输入。尽管缩小了与顶级竞争对手的智能差距,xAI 仍将每百万输入 token 的价格维持在 2.00 美元,每百万输出 token 的价格维持在 6.00 美元。这种成本结构使得 Grok 4.6 的价格远低于 Claude Opus 5 和 GPT-5.6 Sol 等同级别的前沿模型,后者的每 token 定价更高。该模型现已通过开发者 API、Cursor 和 Grok Build 环境提供。
Prepared by Jonathan Pierce and reviewed by editorial team.
强调了竞争市场变化和科技巨头面临的成本压力。 客观地关注了基准改进、定价结构和独立指标。 强调了技术的快速扩展、美国在创新方面的领导地位以及经济价值。
xAI 官方系统发布公告,日期为 2026 年 8 月 12 日。 https://venturebeat.com/technology/spacexai-debuts-grok-4-6-overtaking-kimi-k3s-performance-and-matching-gpt-5-6-sol-for-worlds-third-best-on-artificial-analysis
No left-leaning sources found for this story.
xAI 发布 Grok 4.6,以更低的成本触及智能前沿
Artificial Analysis VentureBeat Artificial Analysis Implicator.ai Artificial Analysis Indian Express DataNorth AI Codersera Powerdrill AI BenchLM.ai OpenRouter Cursor Blog VentureBeat Implicator.ai TechCrunch The Verge ZDNET InfoWorld Tom's Guide Forbes Reuters Bloomberg Ars Technica Business Insider CNET The Register SiliconANGLE DataNorth AI Indian ExpressNo right-leaning sources found for this story.
Comments