打开网易新闻 查看精彩图片

很难受,我的token焦虑越来越强了……

上个月,跑了一个Agent项目,用的是国产模型的API。

项目跑了两天,token消耗700多万。

经常不敢放开聊日常的、随意的话题,因为眼见着token往下掉,虽然已经开了最贵的Token Plan,还是不够用。

就像开电车跑川藏线,不敢加速,不敢开空调,就怕开到一半,电量到0了。

看到讯飞星辰MaaS平台,Qwen3.6-35B-A3B和Qwen3.5-35B-A3B,两款模型开放免费调用,token还不限量。

我第一反应是出bug了。

连笨笨的豆包都要收费了,更强的模型API,还能免费?

打开网易新闻 查看精彩图片

https://maas.xfyun.cn/modelSquare?ch=MaaS-jgkol-d9Q5u

哪怕不是开发者,纯日常工作、聊天,我都觉得值得一用。

查了一下,讯飞星辰MaaS平台,三方开发者日均Tokens调用量,同比涨了4241%。

要真这么用,再多token也顶不住啊,且用且珍惜!

01更好的模型,免费用?

先看这两个免费的模型,是什么来头。

Qwen3.6-35B-A3B,今年4月16日由阿里千问团队正式开源的MoE模型。

总参数量350亿,但运行时只激活30亿参数。这个“只激活30亿”是关键。

传统的稠密模型,不管你让它做什么,都会把全部参数拉出来遛一圈,好比给小学生出个加减法,你把全公司的人都叫来开会。

打开网易新闻 查看精彩图片

MoE架构不一样,它内部有256个小型专家网络,每次只激活跟当前任务相关的8个专家。

一个只激活30亿参数的模型,在SWE-bench Pro编程基准测试上跑出了49.5%的分数,直接把270亿参数的稠密模型Qwen3.5-27B给超了。

更夸张的是,在Terminal-Bench 2.0上,51.5分,比Qwen3.5-27B高出近10个百分点。

打开网易新闻 查看精彩图片

我拿了几个实际任务来测。

拿比较日常的场景来说,延迟很低,输出短平快,结果也准确。

比如我让“用经济学原理解释折扣”。

打开网易新闻 查看精彩图片

再比如,结合AI异类弗兰克的公开信息,做一个专属我自己的个人网站。

这是很具体的场景。

网站要包含个人简介、代表作列表、过往经历等等,风格要简洁专业,适配移动端。

因为很了解我自己,也做过不止一版个人网站,测这个案例,内容准确性、信息排列什么的,一眼就能看出好坏。

我把需求写得很随意,没有给设计稿,只说科技简洁风格,要有现代感。

打开网易新闻 查看精彩图片

模型先是开始规划,给了我类似PRD的网站说明和规划。

它输出了一份网站架构说明,包括页面结构、导航菜单、内容区块划分。

然后生成完整代码,HTML、CSS、JavaScript全在一个文件里。

打开网易新闻 查看精彩图片

很快就有完整的代码和预览效果出来。

是我想要的科技极简的风格。

打开网易新闻 查看精彩图片

我仔细看了代码,书写逻辑是清晰完整的。

代码里还有一个细节。

它自己加了一个暗色模式切换按钮,用localStorage记住用户偏好,可调颜色。

这个需求我完全没有提,模型觉得个人网站应该有这个功能,自作主张加上了。挺有意思的。

一个版本不够,我还让延伸了一个形态。

打开网易新闻 查看精彩图片

它也生成了代码,效果也还不错。

第一遍给出的代码,稍改文字内容,就能直接用。

对于开发者来说,省掉的有生成时间、调试返工的时间,还有钱。

这就是Qwen3.6的含金量。原生多模态,128k超长上下文窗口,Agent编程能力从头到尾全链路都能搞定。

在视觉语言基准测试里,它的部分表现已经和Claude Sonnet 4.5持平,RefCOCO评分92.0。

把这样级别的模型拿出来做免费不限量调用,讯飞星辰MaaS这波操作的诚意有多大,做开发的都懂。

02从注册到跑起来,5分钟搞定

说说操作流程,我尽量写得细致一些。

首先,访问讯飞星辰MaaS平台,网址放在这里:

https://maas.xfyun.cn/modelSquare?ch=MaaS-jgkol-d9Q5u

进去以后,在模型广场找到Qwen3.6-35B-A3B的卡片,点击API调用。

打开网易新闻 查看精彩图片

然后,系统会让你创建一个应用,随便填个名字,没有特殊要求。

创建完成后,你就能看到三样东西:

OpenAI接口地址、APIKey、Model ID

这三样是后续配置的核心,建议直接复制保存。

打开网易新闻 查看精彩图片

接下来,拿这三个信息去配置Agent。

我以OpenClaw为例,进入模型设置页面,选自定义服务商,然后填:接口地址填Base URL,API Key粘贴,Model ID填进去——注意是modelId,不是模型名称。

选OpenAI格式兼容,保存。

整个过程不超过五分钟。

配置完成后,去对话框发一条消息,比如“介绍一下你自己”。

打开网易新闻 查看精彩图片

如果能正常回复,恭喜你,已经成功了。你还可以去后台看token用量,现在显示∞,不限量。

顺便提一句,如果你用的是Cherry Studio来测试API连通性,流程更简单——

直接添加模型提供商,填URL、API Key和Model ID,测试连接就行。

除了OpenClaw,Claude Code、Hermes或者其他兼容OpenAI格式的工具,流程都一样。

甚至可以直接把三个关键信息发给Agent,让它自己去配置。

活动持续到6月30日,时间窗口还剩不到一个月。我身边有个朋友两天跑了2亿token,稳得很。

还有一个细节。

如果对模型稳定性有极高要求,或者需要企业级服务保障,讯飞星辰MaaS平台上新了付费的Token Plan。

打开网易新闻 查看精彩图片

主打稳定性和高并发,按需订阅,适合生产环境部署。

算下来,性价比很高,是适合多囤些那种,以防后面涨价。

免费权益不限量,适合开发和测试阶段;付费服务,更适合规模化上线。

两条路都给你铺好了。

03免费背后的行业逻辑

这几年比较关注MaaS赛道,我也想聊聊自己对这波免费操作的判断。

2025年,中国公有云上的大模型调用量达到1944万亿Token,同比增长16倍。

Token,正在成为AI时代新的计量单位——好比互联网时代的流量、工业时代的电量。

谁能掌握Token的入口,谁就握住了下一张船票。

讯飞星辰MaaS平台去年交出了一份不错的成绩单。

据财报披露,开放平台全年营收60.88亿元,同比增长17.72%,其中大模型API及模型服务(MaaS)收入3.85亿元,同比大增263%。

2026年一季报显示,平台三方开发者日均Tokens调用量同比激增4241%。

说明讯飞在MaaS赛道上的打法,已经开始兑现结果了。

打开网易新闻 查看精彩图片

他们选择在这个时间点开放Qwen3.6这类顶流模型的免费调用权益,目的很明显,就是抢开发者。

不是做做样子,是直接砸出最核心的资源,让你零门槛上车。

等你用顺手了,代码写完了,Agent跑起来了,你觉得你还会换平台吗?

这就跟你用惯了VS Code或者Claude Code一个道理——工具链的转换成本,远比账单上的数字高得多。

从技术层面看,讯飞做这件事有个天然优势。

MaaS平台竞争到最后,拼的是算力规模、模型丰富度和生态粘性。

讯飞在国内语音和AI领域深耕多年,本身就有庞大的开发者基础。

再加上星火大模型和星辰MaaS底座的双轮驱动,他们正在把Token调用量从短期流量红利转化为长期增长曲线。

免费权益是钩子,稳定的服务是鱼竿,你上了钩,就很难再跑。

04对开发者来说,价值不止免费

Qwen3.6-35B-A3B这个模型,我认为它的意义不止于免费调用。

它代表了大模型演进的一个重要方向。

过去两年,大模型圈子里有一条朴素信念:参数越多越强。

70B比7B强,130B比70B强,大家一路往大里卷。

但到了2026年,方向开始分化了。

一部分玩家继续走大而全的路线,另一部分开始探索小而精的路径——用更少的计算资源,提供足够强的能力。

Qwen3.6-35B-A3B就属于后者。

它证明了在编程这个场景下,模型效率的优化可以弥补参数规模的差距。

打开网易新闻 查看精彩图片

企业部署模型需要考虑成本,在效果够用的情况下,能用30亿激活参数跑完的任务,为什么要花70亿的成本?

尤其在端侧AI和自动化智能体需求激增的背景下,这种低功耗高智能的模型会更受欢迎。

实测下来,Qwen3.6在代码生成、调试和多模态推理上的表现,已经可以和参数规模大得多的模型掰手腕。

而它的架构复杂度、推理延迟和硬件门槛,远低于那些动辄几百亿甚至千亿参数的巨头。

我甚至听说有人在GTX 1060 6GB这种入门级显卡上跑通了Qwen3.6-35B-A3B。

打开网易新闻 查看精彩图片

虽然内存占用要靠参数调优来压,但能跑起来这个事实本身就说明了很多问题。

这对于想做本地部署或者对算力敏感的开发团队来说,是个值得关注的方向。

不用再为了跑一个编程助手去搞八卡A100集群,一张中端卡、甚至一台普通笔记本,可能就够了。

05现在这个节点,别错过

这波免费活动,6月底结束。

我的建议是,不管你手头有没有项目,先去把APIKey和Model ID拿到手

注册不花钱,配置不费时,十分钟搞定的事情,不要等到活动结束了才想起来用。

薅羊毛大家不在乎,更重要的是,这是一个信号。

打开网易新闻 查看精彩图片

MaaS行业正在经历从按token计费到包月不限量、再到免费拉新的定价模式变革。

科大讯飞在MaaS赛道的布局,从去年的营收和调用量数据来看,已经显示出很强的增长势能。

当行业龙头开始用免费资源打通开发者生态,接下来会发生的,是整个使用习惯的迁移。

你可以把这当作一个观察窗口,免费试用一个月,看看Qwen3.6到底能为你做什么。

如果你的Agent项目正在为token成本发愁,这一个月可能是你把想法变成现实的最好时机。

打开网易新闻 查看精彩图片

平台入口再放一次:

https://maas.xfyun.cn/modelSquare?ch=MaaS-jgkol-d9Q5u

今天就注册。

拿到Key和Model ID,跑通一次API调用。

会发现,原来用上顶级开源大模型,门槛可以低到这种程度。

对了,现在添加讯飞工作人员,还能领取高并发权益~

不要错过哦~

打开网易新闻 查看精彩图片