OpenAI的旗舰模型GPT-6 Astra已经在OpenRouter平台上线了。它的定价是每百万输入token收费10美元,每百万输出token收费50美元。这个价格在OpenRouter上属于什么水平?从上下文窗口来看,它支持100万token的上下文长度,发布时间是2026年9月4日。

为什么叫"Astra"?OpenAI给它的定位是"处理高要求端到端工作的旗舰模型"。官方描述里提到的适用场景包括高级分析、软件工程、深度研究、科学工作和文档创作。它在涉及计算机和浏览器使用的长周期代理任务(agentic tasks)上表现突出——这类任务通常需要模型在长时间内自主决策并执行多步操作。

打开网易新闻 查看精彩图片

实际支付价格可能远低于标价

OpenRouter平台上的价格机制值得细看。平台显示的是各提供商挂出的价格,但用户实际支付的平均价格往往低于标价。原因在于缓存和折扣机制——当请求命中缓存时,费用会大幅降低。这意味着,虽然标价是10美元/50美元每百万token,但实际账单可能比这个数字温和不少。

OpenRouter的运作方式也值得一提:同一个模型由多家公司托管,平台根据你选择的路由模式把请求分发到其中一家。路由模式有三种:Balanced(平衡价格和速度)、Nitro(最快响应)和Exacto(最高工具调用准确率)。这种多提供商架构让用户可以在价格、速度和准确性之间做取舍。

性能数据:吞吐量58 tok/s,可用性98.56%

从OpenRouter公布的实测数据来看,GPT-6 Astra的吞吐量为每秒58个token(P50,各提供商中的最佳值),延迟为2.31秒(P50,最佳提供商),过去3天的正常运行时间为100%,推理可用性为98.56%。

这里有个细节:OpenRouter的可用性数据显示,启用路由时可用性为98.57%,而不启用路由时只有95.24%。差距来自平台的故障恢复机制——当上游提供商出错时,如果请求过滤器允许,平台会把请求路由到另一家健康的提供商。这个机制把可用性提升了超过3个百分点,对依赖稳定API的生产环境来说,这个差距可能意味着完全不同的服务等级。

谁在用这个模型?Hermes Agent是最大流量来源

OpenRouter还公开了哪些公开应用在向这个模型发送最多流量。目前排在第一的是Hermes Agent,一个由Nous Research开发的开源、自我改进的AI代理。它能够跨会话持久运行并保留记忆,还能从经验中构建可复用的技能。内置40多种工具,包括网络搜索、浏览器自动化和视觉能力,还支持定时自动化和子代理。

这个流量数据透露了一个信号:GPT-6 Astra的实际生产负载集中在代理型应用上,而不是简单的问答或文本生成。这与OpenAI官方对模型的定位——"长周期代理任务"——形成了呼应。也就是说,愿意为50美元每百万输出token买单的用户,多半是在跑那些需要模型长时间自主工作的复杂任务。

接入方式:OpenAI兼容API,换base URL即可

对开发者来说,接入GPT-6 Astra的成本并不高。OpenRouter的API是OpenAI兼容的,大多数SDK只需要替换base URL就能工作。不同模型之间唯一需要改动的就是模型slug(模型标识符)。这意味着,如果你已经在用OpenAI的API,切换到OpenRouter上的GPT-6 Astra几乎不需要改代码。

这个设计降低了迁移门槛,也让开发者可以灵活地在不同模型和提供商之间切换,而不必绑定某一家云服务商。

怎么理解这个定价?

50美元每百万输出token的价格,在OpenRouter的模型列表里属于高端价位。但考虑到它100万token的上下文窗口和长周期代理任务的定位,这个定价逻辑更像是按"任务复杂度"而非"token数量"来收费——一个需要模型连续操作浏览器、调用工具、跨会话记忆的代理任务,消耗的推理资源远高于普通对话。

OpenRouter的监控数据还显示,平台会持续监控各提供商的运行状态,当某个提供商返回错误时自动切换到下一个最佳提供商。这种容错机制对跑生产负载的团队来说,意味着更少的服务中断和更稳定的响应时间。

GPT-6 Astra的上线,把OpenAI的旗舰能力带到了OpenRouter这个聚合平台上。对开发者而言,多了一个选择:不用绑定单一云厂商,就能用上当前OpenAI最强的模型,而且实际支付价格可能比标价低不少。