
Grok 4.6 来了:价格只有对手零头,性能却摸到了第一梯队
这周 AI 圈是真的热闹。8 月 11 日到 12 日这两天,Grok 4.6、Qwen3.8-Max、DeepSeek V4 Pro、微软的 MAI-Thinking-1 扎堆发布,被圈内人直接叫「前沿模型日」。但要说最抢眼的,还得是 xAI 的 Grok 4.6——不是因为参数最大,是因为它把「性价比」三个字玩明白了。
性能什么水平?摸着第一梯队的边了
先说结论:Grok 4.6 是个确认的 1.5T 参数大模型,官方说是在 4.5 基础上重点强化了长时运行的 agent 能力和视觉交互。独立评测机构 Artificial Analysis 给它打了 61 分的智能指数,大概什么位置呢?跟 GPT-5.6 Sol Max 基本持平,排在 Claude Opus 和 Claude Fable 后面——也就是说,稳稳的第二梯队头部,跟第一梯队只差半个身位。
更亮眼的是跑分细节:Terminal-Bench v2.1 上拿了 88.4%,这是个专门测终端操作能力的基准;在 GDPval-AA 的 Elo 评分里冲到 1753。翻译成人话就是:让它自己干活、自己操作电脑、自己写代码,它干得相当利索。
真正的杀手锏:价格
性能摸到第一梯队不算稀奇,稀奇的是价格。Grok 4.6 的 API 定价是每 100 万 tokens 输入 2 美元、输出 6 美元——这个价格只有同级别对手的零头。xAI 自己都说,这是在 4.5 的基础上「加量不加价」。
开发者圈的反应很真实。消息一出,已经有人把它当成写代码和查 bug 的默认选择。毕竟对大多数团队来说,模型能力差个 5%,用户感知不明显;价格贵一倍,成本报表可是肉眼可见。性价比这种东西,在 AI 时代比任何时候都致命。
Grok Bot 才是这盘大棋
比模型本身更值得关注的,是 xAI 同时上线的 Grok Bot——一个早期 beta 版的「AI 队友」。它的玩法是:登录你的工具,像人一样操作,然后把干完的活交给你。这条推文发出来 22.9 百万次浏览,2.3 万回复,热度说明一切。
你品品这个信号:2026 年的大模型战场,已经从「谁能生成更好的文字」打到了「谁能真正替你干活」。Claude 有 Tag,Block 有 Buzz,现在 Grok Bot 也下场了。AI 从聊天工具变成同事,这个拐点,真的来了。
对我们普通人意味着什么
说点接地气的。模型越来越强、越来越便宜,最终受益的还是使用者。以前用 AI 写个周报都心疼 token 钱,现在这个价格,随便造。更关键的是 agent 化——以后让 AI 帮你订机票、整理报销、回邮件,可能真的跟雇个助理一样自然。
当然,跑分是跑分,实际体验还得等大家上手。但有一点可以确定:这场价格战打下去,最先慌的不是开发者,是那些靠信息差收费的中间商。时代变得快,咱们普通人就记住一条:好东西会越来越便宜,别急着当韭菜。
评论 (0)
暂无评论,来写第一条吧 ✍️