8月12日,马斯克旗下 xAI 正式发布新一代大模型 Grok 4.6,重点强化长时智能体与复杂编程能力。在多项评测中,Grok 4.6 在 GDPVal-AA v2 上取得 1753 Elo 的成绩,超过 GPT-5.6 与 Claude Fable 5,登顶多项智能体测试。

主打高性价比与长任务能力
与此前版本相比,Grok 4.6 的核心变化在于”长时智能体”——它更擅长处理需要长时间、多步骤推理的复杂任务,例如跨多个文件的大型代码重构、需要持续跟踪状态的自动化流程等。发布当日,Grok 4.6 便已接入 Cursor、Grok Build 及 OpenRouter 等渠道,开发者可以第一时间调用体验。
在竞争格局上,Grok 4.6 的发布恰逢 DeepSeek-V4-Pro 同步上线,两大模型正面交锋,均主打高性价比与智能体长任务场景,引发全球 AI 圈高度关注。一个明显的趋势是,模型厂商的竞争焦点已经从”谁更会聊天”,转向”谁能稳定地完成复杂、长时间的任务”。
价格战向智能体时代延伸
在定价上,Grok 4.6 的 API 价格仅为其他前沿模型约一半,延续了 xAI 一贯的高性价比打法。业内分析认为,这标志着大模型竞争已从单纯的价格战,进一步延伸到智能体时代——厂商比拼的不再只是”谁更便宜”,而是”谁能用更低的成本,稳定完成更复杂的任务”。对开发者和企业客户而言,这无疑是利好,更多高性价比的智能体模型正在加速到来。
来源:华尔街见闻
© 版权声明
文章版权归作者所有,未经允许请勿转载。
THE END





























暂无评论内容