这两年 AI 爆火,不少公司将部分业务直接交给 AI 处理,比如客服、知识库、开发等等。
不得不说,公司的业务处理效率的确能提上来,但月底看 Token 支出账单也真的吓人。
如何把 AI 使用成本降下来,现已经,是很多公司或团队眼下急需面对的问题。
上个月,带大家在讯飞星辰 MaaS 平台上,薅了一波免费不限量 Qwen 模型使用。
最近发现又有新活动,Qwen3.6-35B-A3B 和 Qwen3.5-35B-A3B 模型,直接打 6 折。
如果日均模型调用需达到 30 亿 Tokens,每周返实付金额 30% 的代金券。
若日均达到 100 亿,直接全额返还,这不就相当免费了吗,又能狠狠薅一波。
有点像我们生活水电的阶梯价,只不过方向反过来了,水电是用的越多单价越贵。
而这次平台搞的活动,用的越多则返得越狠,明显是冲着企业和大调用量团队来的。
更重要的是,返还的代金券不指定模型,平台模型集市上所有模型均可使用。
上面有讯飞星火、DeepSeek、Qwen、Kimi、GLM 等几十款热门主流模型。
不过返利,需要先添加平台技术支持的微信,由技术人员完成配置,具体流程下面一并讲。
那这一波羊毛怎么薅,下面带大家走一遍。
首先打开讯飞星辰 MaaS 平台:https://maas.xfyun.cn/modelSquare?ch=MaaS-jgkol-A8G3
进入模型集市,找到 Qwen3.6-35B-A3B 或 Qwen3.5-35B-A3B 模型:
然后点击「API 调用」,随便填一个模型服务 API 名称,按系统推荐的来填就行。
如果没有可授权的应用,先点「前往创建应用」,到讯飞开放平台,建好应用再回来。
点击「确定」之后,API 调用申请就好了,将进入到模型服务页面。
在这里,拿到的 modelId 和 APIKey,支持 OpenAI 和 Anthropic 两种协议调用 API。
如果我们原来对接过这两家接口的业务,只需改个地址、换个 Key 就能切过来。
对于个人或团队,也可以将其接入到我们使用的 Agent 工具,比如 WorkBuddy:
至于返利的领取有三步。
先回到 Qwen3.6-35B-A3B 模型详情页,鼠标移到「更多优惠咨询」上,添加工作人员。
然后把日均调用量和业务场景告诉对方,确认符合哪一档的返利。
日均使用达到 30 亿 Tokens,按周返 30% 实付金额代金券。
日均使用达到 100 亿 Tokens:按周返全额实付金额代金券。
由工作人员配置完成后,便可进行结算,返还的代金券将直接打进我们的账户。
顺便跟大家聊一下,团队里什么样的业务量,会摸到日均 30 亿 Tokens 这个门槛。
我盘点了一下,有以下几个常见使用场景。
首先想到的是智能 AI 客服。一个问题咨询往往有十几轮的对话,每轮都带着历史上下文。
再加上 AI 要在知识库里检索,咨询量大的产品,可以想象一下 Token 消耗得多恐怖。
另外是内部 AI 助手,现在很多公司的日报、周报、考勤这些日常工作都交给 AI 处理。
虽然这些处理看起来都挺简单的,但如果公司人数多,算下来消耗的 Token 也不少。
还有用 AI 辅助文档分析,像合同、财报、标书这些动辄上百页的文件。
这些使用场景都有个共同点,对模型能力要求不算特别高,但消耗的 Token 也是真的多。
而 Qwen3.6-35B-A3B 这模型我觉得正好合适,混合多模态模型,响应快,成本也低。
不过说实话,如果是一些复杂的业务场景、需要用到深度推理,该用旗舰模型还是得用。
但企业每天烧掉的 Token 大头,恰恰是那些用不着顶级模型的日常频繁调用场景。
如果把这部分用到便宜的模型上,我相信,模型账单能以肉眼可见的速度爆降。
而这一次羊毛,对于调用量大的企业或团队来说,的确值得薅上一波。
地址:https://maas.xfyun.cn/modelSquare?ch=MaaS-jgkol-A8G3
今天的分享到此结束,感谢大家抽空阅读,我们下期再见,Respect!

