2026 年 9 月 3 日 OpenAI 放出 GPT-6 Astra 的限量预览,9 月 5 日起分批公开。
接下来这一周,你会在各处看到「已支持 GPT-6」的字样。
这篇不谈它有多强,只谈三件能自己动手核实的事:**它到底叫什么、贵到什么程度、
以及怎么用一条命令判断某个端点是不是真的接上了它**。文中所有返回值都是
9 月 5 日当天跑出来的,你现在就能复现。
过去五个月里「GPT-6」这个词被用过至少三次,指的不是同一个东西:
时间 | 传闻里叫什么 | 实际发出来的是什么 |
|---|---|---|
2026 年 4 月 | 内部代号 Spud,传「GPT-6 已完成预训练」 | GPT-5.5(4 月 23 日发布) |
2026 年 6 月 | — | GPT-5.6 系列:Sol(旗舰)/ Terra(均衡)/ Luna(低成本) |
2026 年 9 月 3 日 | — | GPT-6 Astra,这次是真的 |
所以现在网上仍有大量四月写的「GPT-6 评测」,讲的其实是 GPT-5.5。
判断一篇文章说的是不是这一个,看它有没有出现 gpt-6-astra ——
这是 OpenAI 给的 API 模型标识符,也是唯一不会混的叫法。
另外还有一档 GPT-6 Astra Pro,只对 ChatGPT Pro 和企业订阅开放,不在 API 里。
项目 | 值 |
|---|---|
API 模型 ID |
|
上下文窗口 | 1,050,000 token |
最大输出 | 128,000 token |
知识截止 | 2026 年 4 月 30 日 |
输入模态 | 文本 + 图片(音频、视频不是原生模态) |
🔴 迁移坑在推理强度上。 GPT-6 Astra 支持 low / medium / high / xhigh / max 五档,
但不支持 none。如果你的代码是从 GPT-5.6 迁过来的、请求里写着 none 或 minimal,
换模型后会直接报错。官方建议从 low 开始试。
这个坑值得单独记一笔:它不是性能问题,是参数取值集合变了,
而报错信息通常只说参数无效,不会告诉你「这一档在新模型里被取消了」。
单位是每百万 token,美元:
输入 | 缓存输入 | 输出 | |
|---|---|---|---|
标准(≤272K 输入) | 10 | 1 | 50 |
超过 272K 输入 | 20 | 2 | 75 |
三个参照系,帮你把这个数字放进上下文:
⚠️ 跳档规则要看清:不是超出部分按高价,是整次请求都按高价重算。
一个 273K token 的输入,全部按 20 美元/百万计,不是前 272K 按 10、超出部分按 20。
做长文档处理的,这条会直接决定你要不要在 272K 处切分。
新模型发布后的头几天,「已支持」这三个字最不值钱——**上线一行文案的成本,
远低于真正接通一个模型**。好在这件事可以自己验,不用信任何人的说法。
curl -s https://端点地址/v1/models | head -c 3009 月 5 日实测七个地址,原始返回如下:
端点 | HTTP | 返回 |
|---|---|---|
| 401 |
|
| 401 |
|
| 401 |
|
| 401 |
|
| 401 |
|
| 401 |
|
| 200 | 完整 JSON,17 个模型 ID |
结论很直接:绝大多数端点的模型清单是鉴权的,不带 key 你看不到。
所以第一级验证的作用不是「看到清单」,而是排除掉那些连接口都没有的地址——
401 说明你找对门了,404 说明门都敲错了。这两个返回码的区别比很多人以为的重要。
⚠️ 还有一种更隐蔽的情况:200 但返回的是一张 HTML 网页。
那说明 /v1/models 在那个域名下不是 API 路径,你的请求落到了站点的网页路由上。
只看状态码会被它骗过去,所以上面那条命令一定要带 head -c 300 看内容。
curl -s https://端点地址/v1/models \
-H "Authorization: Bearer 你的key" | grep -io "gpt-6[a-z0-9.-]*"有输出,说明这个端点的清单里确实登记了它。
清单里有 ≠ 真的能调。有的服务会把不存在的模型名静默映射到别的模型上——
你以为在用 GPT-6,实际跑的是 5.6 甚至更早的版本,而返回是正常的,不会报错。
验证办法是发一个最小请求,然后看响应体里 model 字段回的是什么:
curl -s https://端点地址/v1/chat/completions \
-H "Authorization: Bearer 你的key" \
-H "Content-Type: application/json" \
-d '{"model":"gpt-6-astra","messages":[{"role":"user","content":"hi"}],"max_tokens":8}' \
| grep -o '"model":"[^"]*"'请求里写的和响应里回的对不上,就是被映射了。 这一条对中转服务尤其值得跑,
它比任何宣传页都可靠——毕竟你验的是它自己返回的数据。
新模型发布后的两周内,别把生产流量直接切过去。原因不是模型不好,是周边还没跟上:
none 被取消)通常要一周才被人写出来先用第三级验证确认你手上的端点是真的,再小流量跑几天,看清楚账单再说。
# 一、端点有没有 Anthropic/OpenAI 格式的模型接口
curl -s https://端点地址/v1/models | head -c 300
# 二、清单里有没有 GPT-6(要 key)
curl -s https://端点地址/v1/models -H "Authorization: Bearer 你的key" \
| grep -io "gpt-6[a-z0-9.-]*"
# 三、真发一次,看响应里的 model 字段对不对得上
curl -s https://端点地址/v1/chat/completions \
-H "Authorization: Bearer 你的key" -H "Content-Type: application/json" \
-d '{"model":"gpt-6-astra","messages":[{"role":"user","content":"hi"}],"max_tokens":8}' \
| grep -o '"model":"[^"]*"'三条命令都不需要注册任何服务就能跑前一条,后两条用你已有的 key 即可。
验证成本是零,被一句「已支持」误导的成本不是。
*本文作者本人也在做 AI 接入这一类服务。上表里 flex-api.code2ai.codes 那行是
自家端点,之所以放进去,是因为它是七个里唯一不带 key 也能看到完整模型清单的——
这一点你自己 curl 一下就能验,不用信我。*
原创声明:本文系作者授权腾讯云开发者社区发表,未经许可,不得转载。
如有侵权,请联系 cloudcommunity@tencent.com 删除。