来源:市场资讯

(来源:AI信息Gap)

你的 token,正在变得越来越贵。

DeepSeek-V4 正式版即将上线,同时 DeepSeek 官宣引入峰谷定价,工作日白天 9 点到 12 点、14 点到 18 点 API 价格翻倍。一直以性价比著称的 DeepSeek,要开始按时段收费了。

同一时间 Kimi K3 发布 48 小时后算力告急,月之暗面宣布暂停 C 端新用户订阅,把全部可用算力用于服务现有用户。现在新用户想掏钱订阅都没货。

涨价、限购,别家都在收紧,讯飞却反手推出了一个「全额返利」活动。

讯飞星辰 MaaS 平台的模型集市,针对阿里千问 Qwen3.6-35B-A3B 和 Qwen3.5-35B-A3B 两款模型推出了阶梯返利活动,这两款模型本身已经是 6 折定价,在 6 折的基础上再返利。

规则很有意思。如果日均调用量达到 30 亿 tokens,讯飞按周返还你实付金额的 30%;达到 100 亿 tokens,100% 全额返还。划重点,这里返的是讯飞 MaaS 平台代金券,全场通用,DeepSeek-V4-Pro、GLM-5.2 等 60 多个模型都能用,没有限制。

说实话,第一次看到「100% 全额返利」,我还以为我看错了。

打开网易新闻 查看精彩图片

Qwen3.6-35B-A3B 6 折后的定价是输入 1.08 元/百万 tokens,输出 6.48 元/百万 tokens。假设一个大型团队日均调用 100 亿 tokens,按输入输出各一半粗略估算,一天的推理费用就是 3.78 万元,一周实付 26 万左右。调用量达标之后,这 26 万会以代金券的形式按周返还到你的账户,可以用来调用平台上的其他模型。

调用越多越划算。四舍五入,这几乎就等于白嫖了 100 亿 tokens。

你花在 Qwen 上的钱,全额返还。下一周的所有调用,讯飞请客。

太狠了。

重点来了,怎么获得「全额返利」?

用下面的链接打开讯飞星辰 MaaS 平台模型集市,手机号或者微信扫码登录。

传送门:https://maas.xfyun.cn/modelSquare?ch=MaaS-jgkol-U5P9

在「模型集市」里找到 Qwen3.6-35B-A3B,点「API 调用」。

打开网易新闻 查看精彩图片

填一个服务名称,选择要授权的应用。

如果还没有应用就点旁边的「前往创建应用」跳转到讯飞开放平台,填个名字和描述提交就行,创建完成后回到 MaaS 平台刷新应用列表,选中刚创建的应用确认,系统会自动跳转到模型服务列表页面,API Key 和接口地址都在那里。

打开网易新闻 查看精彩图片

讯飞同时兼容 OpenAI 和 Anthropic 接口,改一下 base_url 就能切换。

打开网易新闻 查看精彩图片

最后一步是领取返利。

在模型详情页找到「更多优惠咨询」,扫码添加讯飞技术人员的微信就能领取返利了。

打开网易新闻 查看精彩图片

Qwen3.6-35B-A3B 是阿里千问团队今年 4 月开源的 MoE 架构模型,总参数 350 亿但每次推理只激活 30 亿,主打一个性价比。它原生支持多模态,文本、图像都能处理,视觉语言能力在多个基准上已经和 Claude Sonnet 4.5 坐一桌了。

这种激活参数少、能力全面的模型,才撑得起讯飞 的 6 折加全额返利。

打开网易新闻 查看精彩图片

如果你的团队已经在用大模型跑智能客服,每天处理几万轮用户对话,token 烧得飞起,讯飞这个返利活动就是为你准备的。公司搭建了内部知识库的也一样,员工每天查询几千次公司文件、操作手册、历史工单,token 成本不断上涨,越用越贵。

做文档自动化的团队更不用说了,财务批量处理报表、发票,法务审阅合同条款,HR 筛选简历,这些业务一旦接入大模型,调用量越大、文件越多 token 花得越多。研发团队把 Qwen3.6-35B-A3B 接入内部工具辅助编程,代码审查、bug 修复、单元测试生成,每天的 token 消耗也是轻松过亿。

只要你的业务已经在大规模调用大模型 API,日均 token 消耗在 30 亿以上,这个阶梯返利就是真香。6 折定价加上返利,实际 token 成本比自己部署开源模型要低多了。

大模型的定价,从按 token 计费卷到了峰谷分时段,现在又卷出了阶梯返利。

算力开始有了规模效应,用得越多单价越低。