01
在长轨迹中构建、测试与迭代
Grok 4.6 针对知识工作、通用编程、内核优化、Web 开发、计算机辅助设计等智能体环境进行了训练。xAI 报告称,它在长轨迹中会进行更多自测与验证。
- 500,000 tokens 上下文窗口
- 文本和图片输入、文本输出
- low、medium、high 与 xhigh 推理
- Responses API 上下文压缩支持长智能体循环

透明定价,无隐藏费用。按量付费,用多少付多少。
| 型号 | 规格 | PoYo价格 | 官方价格 | 为你节省 |
|---|---|---|---|---|
Input | $1.60/1M tokens 320 积分 /1M tokens | $2.00/1M tokens Official | 20% | |
Output (including reasoning tokens) | $4.80/1M tokens 960 积分 /1M tokens | $6.00/1M tokens Official | 20% |
* 实际费用以最终输出为准。
使用 面向长流程智能体的 Grok 4.6 API 的完整指南
Grok 4.6 是 xAI 面向编程、工程、知识工作以及复杂交互与视觉项目的前沿模型。它能够在多步骤任务中持续推进目标,研究陌生领域、处理代码库,并在进入下一步之前主动检查结果。
使用 grok-4.6 调用 /v1/chat/completions 或 /v1/responses。PoYo 每百万 tokens 收取 320 输入积分和 960 输出积分,对应 $1.60 与 $4.80,正好比 xAI 的 $2/$6 官方短上下文标准价便宜 20%。
xAI 官方发布重点展示了更持久的智能体执行,以及交互和视觉项目更强的首轮成果。
01
Grok 4.6 针对知识工作、通用编程、内核优化、Web 开发、计算机辅助设计等智能体环境进行了训练。xAI 报告称,它在长轨迹中会进行更多自测与验证。

02
xAI 将 Grok 4.6 的重点扩展到更复杂的交互和视觉工作。它可以从宽泛需求出发完成规划与实现,并交付结构更完整的应用首版或精细化工作成果。
03
通过 PoYo 的任一接口接入 Grok 4.6,从快速对话测试到长流程智能体都使用同一个公开模型 ID。无需维护第二套集成,即可组合流式输出、工具调用、推理控制与上下文压缩。

在大量步骤中持续完成研究、规划、实现、测试与迭代,不丢失最终目标。
浏览代码库、定位缺陷、实现修改、调用工具,并在智能编程流程中验证结果。
把宽泛的产品想法转化为结构、交互和视觉语言完整的首个可用版本。
在 500K 上下文中分析报告和复杂信息、综合证据,并生成完善的工作成果。
结合函数调用、网页搜索、X 搜索、代码执行、结构化输出和外部应用工具。
通过 low、medium、high 或 xhigh 推理强度,为不同任务平衡延迟与深度。
xAI 官方高推理评测对比 Grok 4.6、Grok 4.5、GPT-5.6 Sol Max 与 Fable 5 Max,覆盖综合智能、编程智能体、终端任务和专业知识工作。
| Benchmark | Grok 4.6 High | Grok 4.5 High | GPT-5.6 Sol Max | Fable 5 Max |
|---|---|---|---|---|
| AA Intelligence Index | 61 | 56 | 61 | 62 |
| GDPVal-AA v2 | 1753 | 1526 | 1728 | 1741 |
| CursorBench v3.2 | 69.9% | 66.7% | 67.2% | 70.5% |
| DeepSWE v1.1 | 65.9% | 54% | 73% | 70% |
| FrontierCode v1.1 Extended | 61.3% | 56.6% | 60.6% | 63.6% |
| APEX-Agents | 57.5% | 47.1% | 56.7% | 59.2% |
| Terminal-Bench v3.0 | 26% | 15.7% | 34.6% | 34.1% |
| APEX-SWE | 56.4% | 53.6% | — | 58.8% |
| AA-Briefcase | 1577 | 1313 | 1502 | 1574 |
| Harvey LAB (Vals) | 15.8% | 12.9% | 2.5% | 11.3% |
xAI 于 2026 年 8 月 12 日发布的官方评测。第三方模型分数采用 xAI 所引用的最佳自报或公开结果。
1. 创建 API Key。登录后创建 PoYo Key。
2. 选择接口。通过 POST /v1/chat/completions 发送 messages 数组,或通过 POST /v1/responses 发送 input;两者都支持流式响应。
3. 设置模型。模型 ID 使用 grok-4.6。客户端支持时,请保持稳定的会话标识以提高 Prompt Cache 命中稳定性。查看 PoYo API 文档。
grok-4.6。POST /v1/chat/completions 和 POST /v1/responses,两者均支持流式与非流式请求。messages 历史;Responses 使用 input,可延续先前响应状态,并为长流程任务提供上下文压缩。使用同一个公开模型 ID 和 PoYo 凭证调用 Chat Completions 或 Responses。
以积分和美元同时展示输入、输出价格,并对比官方短上下文定价。
无需增加新的网关集成,即可与其他供应商模型一起评测 Grok。
切换 Endpoint、测试流式响应、查看服务状态和 token 用量后再投入生产。