首页
学习
活动
专区
圈层
工具
发布
社区首页 >专栏 >GPT-6 Astra 发布首日:模型名、价格,以及怎么验证一个端点真的支持它

GPT-6 Astra 发布首日:模型名、价格,以及怎么验证一个端点真的支持它

原创
作者头像
用户6170966
发布2026-09-05 15:12:56
发布2026-09-05 15:12:56
80
举报

2026 年 9 月 3 日 OpenAI 放出 GPT-6 Astra 的限量预览,9 月 5 日起分批公开。

接下来这一周,你会在各处看到「已支持 GPT-6」的字样。

这篇不谈它有多强,只谈三件能自己动手核实的事:**它到底叫什么、贵到什么程度、

以及怎么用一条命令判断某个端点是不是真的接上了它**。文中所有返回值都是

9 月 5 日当天跑出来的,你现在就能复现。


一、先把版本号理清楚,这块的误会最多

过去五个月里「GPT-6」这个词被用过至少三次,指的不是同一个东西:

时间

传闻里叫什么

实际发出来的是什么

2026 年 4 月

内部代号 Spud,传「GPT-6 已完成预训练」

GPT-5.5(4 月 23 日发布)

2026 年 6 月

GPT-5.6 系列:Sol(旗舰)/ Terra(均衡)/ Luna(低成本)

2026 年 9 月 3 日

GPT-6 Astra,这次是真的

所以现在网上仍有大量四月写的「GPT-6 评测」,讲的其实是 GPT-5.5。

判断一篇文章说的是不是这一个,看它有没有出现 gpt-6-astra ——

这是 OpenAI 给的 API 模型标识符,也是唯一不会混的叫法。

另外还有一档 GPT-6 Astra Pro,只对 ChatGPT Pro 和企业订阅开放,不在 API 里。


二、硬规格:四个数字和一个迁移坑

项目

API 模型 ID

gpt-6-astra

上下文窗口

1,050,000 token

最大输出

128,000 token

知识截止

2026 年 4 月 30 日

输入模态

文本 + 图片(音频、视频不是原生模态)

🔴 迁移坑在推理强度上。 GPT-6 Astra 支持 low / medium / high / xhigh / max 五档,

但不支持 none。如果你的代码是从 GPT-5.6 迁过来的、请求里写着 noneminimal

换模型后会直接报错。官方建议从 low 开始试。

这个坑值得单独记一笔:它不是性能问题,是参数取值集合变了

而报错信息通常只说参数无效,不会告诉你「这一档在新模型里被取消了」。


三、价格:贵,而且超过 272K 会跳档

单位是每百万 token,美元:

输入

缓存输入

输出

标准(≤272K 输入)

10

1

50

超过 272K 输入

20

2

75

三个参照系,帮你把这个数字放进上下文:

  • 与 Anthropic 对 Claude Fable 5.1 的定价持平
  • 是当前促销中的 GPT-5.6 Sol 的 2.5 倍
  • Batch 和 Flex 模式是标准价的一半;Fast mode 是适用费率的两倍

⚠️ 跳档规则要看清:不是超出部分按高价,是整次请求都按高价重算。

一个 273K token 的输入,全部按 20 美元/百万计,不是前 272K 按 10、超出部分按 20。

做长文档处理的,这条会直接决定你要不要在 272K 处切分。


四、发布首日的真问题:谁真的支持了

新模型发布后的头几天,「已支持」这三个字最不值钱——**上线一行文案的成本,

远低于真正接通一个模型**。好在这件事可以自己验,不用信任何人的说法。

第一级:不带 key,直接问端点要模型清单

代码语言:bash
复制
curl -s https://端点地址/v1/models | head -c 300

9 月 5 日实测七个地址,原始返回如下:

端点

HTTP

返回

api.openai.com/v1/models

401

Incorrect API key provided

api.deepseek.com/v1/models

401

Authentication Fails (governor)

open.bigmodel.cn/api/paas/v4/models

401

Header中未收到Authorization参数

api.siliconflow.cn/v1/models

401

Token is invalid

ark.cn-beijing.volces.com/api/v3/models

401

AuthenticationError

dashscope.aliyuncs.com/compatible-mode/v1/models

401

You didn't provide an API key

flex-api.code2ai.codes/v1/models

200

完整 JSON,17 个模型 ID

结论很直接:绝大多数端点的模型清单是鉴权的,不带 key 你看不到。

所以第一级验证的作用不是「看到清单」,而是排除掉那些连接口都没有的地址——

401 说明你找对门了,404 说明门都敲错了。这两个返回码的区别比很多人以为的重要。

⚠️ 还有一种更隐蔽的情况:200 但返回的是一张 HTML 网页。

那说明 /v1/models 在那个域名下不是 API 路径,你的请求落到了站点的网页路由上。

只看状态码会被它骗过去,所以上面那条命令一定要带 head -c 300 看内容。

第二级:带上你自己的 key 再查一次

代码语言:bash
复制
curl -s https://端点地址/v1/models \
     -H "Authorization: Bearer 你的key" | grep -io "gpt-6[a-z0-9.-]*"

有输出,说明这个端点的清单里确实登记了它。

第三级:真发一个请求过去(这一级最容易被跳过,也最有用)

清单里有 ≠ 真的能调。有的服务会把不存在的模型名静默映射到别的模型上——

你以为在用 GPT-6,实际跑的是 5.6 甚至更早的版本,而返回是正常的,不会报错。

验证办法是发一个最小请求,然后看响应体里 model 字段回的是什么:

代码语言:bash
复制
curl -s https://端点地址/v1/chat/completions \
  -H "Authorization: Bearer 你的key" \
  -H "Content-Type: application/json" \
  -d '{"model":"gpt-6-astra","messages":[{"role":"user","content":"hi"}],"max_tokens":8}' \
  | grep -o '"model":"[^"]*"'

请求里写的和响应里回的对不上,就是被映射了。 这一条对中转服务尤其值得跑,

它比任何宣传页都可靠——毕竟你验的是它自己返回的数据。


五、一条建议

新模型发布后的两周内,别把生产流量直接切过去。原因不是模型不好,是周边还没跟上

  • 迁移参数的坑(比如上面那个 none 被取消)通常要一周才被人写出来
  • 各家中转的接入进度不一,同一个模型名在不同端点上的实际行为可能不同
  • 价格跳档规则会让长文档场景的成本估算完全失准

先用第三级验证确认你手上的端点是真的,再小流量跑几天,看清楚账单再说。


附:本文用到的可复现命令

代码语言:bash
复制
# 一、端点有没有 Anthropic/OpenAI 格式的模型接口
curl -s https://端点地址/v1/models | head -c 300

# 二、清单里有没有 GPT-6(要 key)
curl -s https://端点地址/v1/models -H "Authorization: Bearer 你的key" \
  | grep -io "gpt-6[a-z0-9.-]*"

# 三、真发一次,看响应里的 model 字段对不对得上
curl -s https://端点地址/v1/chat/completions \
  -H "Authorization: Bearer 你的key" -H "Content-Type: application/json" \
  -d '{"model":"gpt-6-astra","messages":[{"role":"user","content":"hi"}],"max_tokens":8}' \
  | grep -o '"model":"[^"]*"'

三条命令都不需要注册任何服务就能跑前一条,后两条用你已有的 key 即可。

验证成本是零,被一句「已支持」误导的成本不是。


*本文作者本人也在做 AI 接入这一类服务。上表里 flex-api.code2ai.codes 那行是

自家端点,之所以放进去,是因为它是七个里唯一不带 key 也能看到完整模型清单的——

这一点你自己 curl 一下就能验,不用信我。*

原创声明:本文系作者授权腾讯云开发者社区发表,未经许可,不得转载。

如有侵权,请联系 cloudcommunity@tencent.com 删除。

目录
  • 一、先把版本号理清楚,这块的误会最多
  • 二、硬规格:四个数字和一个迁移坑
  • 三、价格:贵,而且超过 272K 会跳档
  • 四、发布首日的真问题:谁真的支持了
    • 第一级:不带 key,直接问端点要模型清单
    • 第二级:带上你自己的 key 再查一次
    • 第三级:真发一个请求过去(这一级最容易被跳过,也最有用)
  • 五、一条建议
  • 附:本文用到的可复现命令
问题归档专栏文章快讯文章归档关键词归档开发者手册归档开发者手册 Section 归档