大数跨境

AI周报|匿名热场,o3腾位,Qwen4接棒

AI周报|匿名热场,o3腾位,Qwen4接棒 唐门AI OPC社区
2026-08-26
4
导读:8月26日换班日:匿名模型热场,o3腾位置,Qwen4接棒,10万亿在路上,份额换班。



8月26日是个换班日。但这场换班不是今天才开始的,从一周前智谱那个匿名模型冒头就开始了。

8月23日,一个叫Ox Alpha的模型在OpenRouter上开了匿名内测。中文圈给它起了个名字,牛来。免费,随便测。

DeepSWE个人测试,10个任务通过率约80%。Fable 5是65%,GPT-5.6 Sol是52%。一个不敢署名的模型,跑赢了两个署名的。

然后全球AI圈开始找它的身份。有人对比了25组提示词的token计数,Ox Alpha和GLM-5.3之间始终保持着75个token的固定差值。有人把同一段视频喂给不同模型,消耗是296、296、884、1064,一个不差。指纹对上了,主流分析给出99%概率指向智谱。

匿名测试已经是新的发布学了。先把场子炒热,然后换班才好开始。一周之后,8月26日,真正的换班来了。


一、腾位置:o3走,GPT-6在路上

8月26日加州时间OpenAI的o3模型走完90天sunset期,从ChatGPT正式下线。GPT-4.5已经在6月27日先走了一轮,这次轮到o3。ChatGPT里的模型清单又短了一截。

腾位置是为了给GPT-6让路。8月10日的爆料说,内部代号Astra的下一代模型参数冲到10万亿。对照一下,GPT-4是1.8万亿,5倍以上爆料人"ChrisGPT"说,即使面临政府安全审查,Astra仍会在8月强行发布。年底还要推一个代号"Doug"的后续模型。

不是OpenAI一家在卷参数。xAI的Grok 4.6在8月13日发了,1.5万亿。Grok 4.7紧随其后,2.1万亿。上一轮参数军备停在GPT-4的1.8万亿停了一年多,这次重新开卷,起点就是10万亿。

我们给企业做AI选型的时候,参数涨5倍这件事在应用层是另一本账。推理成本跟着涨,客户不会为参数买单,只为结果买单AI机器人项目里,模型选型只占工作量的一小部分,剩下全是流程编排、边界处理、异常兜底。模型贵了客户就换开源,这是去年就跑通的逻辑。


二、踩点接:开源在抢窗口

闭源在腾位置,开源在踩点接。

8月26日北京时间晚上23点,阿里千问在魔搭社区开源Qwen3.8-Flash-Next。多模态MoE架构,FP8版本同步放出来,下一代Qwen4架构第一次公开露脸。预发布页提前一天上线,时间锚得死死的。

开源时间卡在o3下线同一天,是Qwen算出来的。闭源腾位置给GPT-6让路,开源抢GPT-6没发布之前的空档期。窗口期可能就一两个月。

再把时间往回拉一周。8月23日Ornith开源了1.5全系列,397B旗舰追平Claude Opus 4.8。35B那个版本,MoE架构,激活参数只有3B,实测超过同级31B的稠密模型。这个体量意味着一台像样的工作站就能本地跑起来我们做企业NAS加本地数据库这条线,等的就是这类模型。金融、医疗这些数据出不了门的行业,模型进内网是刚需。以前进内网的模型能力不够,够能力的进不了内网。35B激活3B,这个夹缝开始合上了。

视觉那边也在接棒。8月21日DeepSeek上线了V4-Flash-Vision-Exp,第一个多模态视觉理解模型,Agent能力接近Opus-4.8。同一天OpenAI给GPT-Image-2开放了透明背景生成,API里加一个参数,出来的直接是带Alpha通道的透明PNG。五天后Qwen3.8-Flash-Next多模态开源。

视觉能力从演示环节进入生产管线了。以前多模态是发布会上的素材,现在是可以塞进工作流的物料。我们做AIGCC漫剧这条线感受很直接,图层化生产里角色要从背景里剥出来,以前这一步外包或上抠图工具批量跑,现在API一个参数搞定。成本压到十分之一,靠的就是这种单点工序的持续替代。


三、满分靠架构,不是靠参数

10万亿在路上,但满分不是参数赢的。

英伟达的通用Agent架构AVO在ARC-AGI-3上拿了满分。100%,183个关卡全部通过,25个环境全部清场。同一底座模型Claude Opus 5,裸跑只有30%,套上AVO架构之后是100%。模型没换,成绩翻了三倍多

AVO在B200 GPU上连续跑了7天,探索了500多种优化方向,最后找到的方案超过cuDNN 3.5%,领先FlashAttention-4超过10.5%。没人教它怎么通关,它自己把游戏规则摸透了。

Ornith-1.5的训练流程也是这个路子。端到端自改进闭环:模型自己出题,自己搭评测脚手架,自己解题,再用GRPO强化学习联合优化这三步。397B旗舰的成绩追平了Claude Opus 4.8。以后拼的不是谁的数据多,是谁的模型会出题

这两件事放在一起,信号比任何新模型发布都实在。模型是零件,编排才是交付物。参数涨了5倍,编排能力的差距可能就是30%到100%那一段。客户不关心你用哪个模型,客户关心的是他的工单有没有被接住。


四、钱往哪走

把视野拉长到一周看钱往哪走。

8月10日的近期数据:全球AI相关收入约70%由OpenAI和Anthropic两家贡献,Cursor排第三。1月时OpenAI一家份额还接近90%。5月时OpenAI加Anthropic合计89%。现在两家合计70%,OpenAI自己降到65%左右,Anthropic涨到14.9%。

钱在向头部集中,但集中的方向在变。OpenAI不再一家独大,但也不是百花齐放。第二名的位置坐稳了,第三名还在抢。

英伟达8月27日凌晨5点发2027财年第二财季财报。市场一致预期:营收920.5亿美元,同比增长96.92%,接近翻倍。每股收益2.061美元,同比增长90.81%华尔街把这份财报叫"宇宙级财报"。算力层的预期在翻倍,应用层的兑现远远没跟上。英伟达营收涨96%,有几家企业的AI项目敢说自己的ROI涨了96%?

算力在卖铲子,应用在挖金矿。金矿的产能兑现得比铲子销量慢半拍。8月27日凌晨的这份财报是给铲子销量盖个章,金矿的产能还得等。


换班日

把这一周的事压成一句话:匿名模型把场子炒热,o3腾了位置,Qwen4踩点接,参数冲10万亿,架构拿满分,视觉下车间,钱向头部集中

AGI还在路上,但座次已经开始换了。以后拼的不是谁家模型更猛,是谁家的管线能接住多家模型。模型在换班,管线的稳定性才开始值钱。

你今天准备接哪一棒?评论区说。



*资料说明:本文信息基于8月10日至8月26日公开报道,GPT-6/Astra参数规模为爆料传闻,英伟达财报数据为市场一致预期,实际以官方发布为准。*

一键三连「点赞」「转发」「在看」
点亮星标,科技前沿进展每日见

想了解我们在做什么,能帮你做什么,官网都在这:tsai.org.cn。手机上点文末「阅读原文」就能进。

【声明】内容源于网络
0
0
唐门AI OPC社区
1234
内容 36
粉丝 0
唐门AI OPC社区 1234
总阅读8
粉丝0
内容36