9 月 4 日凌晨,OpenAI 正式发布 GPT-6 Astra,具备 105 万 token 上下文窗口,定价为输入 10 美元/输出 50 美元每百万 token,ARC-AGI-3 基准测试达 99.9%。同日晚,ChatGPT、Claude、Grok 三大服务集体宕机近 4 小时,超 1.2 万用户报告故障。AI 行业正经历“能力越界”与“基建脆弱”并存的阶段。对品牌而言,答案层广告、Agent 可操作性及模型安全审计,已成为 GEO(生成式引擎优化)的三条新战线。
目录 Catalogue
- 四主线速览
- 主线展开
- 一周关键数字盘点
- 行动清单
- 下周关注
- 三大重点
- 数据来源说明
01 四主线速览
- 主线 1|模型竞速:Astra 将"Computer-Use"确立为主战场
- 主线 2|资本潮向:从 Kimi 递表到 Anthropic 信贷,IPO 窗口全面开启
- 主线 3|安全与信任:史上最大规模宕机与 Astra“循环深度”争议
- 主线 4|GEO/商业化:ChatGPT 广告 200 天营收破 10 亿美元,答案层流量变现启动
02 主线展开
主线 1|模型竞速:Astra 把"Computer-Use"变成主战场
- GPT-6 Astra:支持 105 万 token 上下文,首个“关键级”网安模型。AI 具备屏幕识别与鼠标操作能力,内容需满足可读、可引用、可操作三重标准。
- Meta Muse Spark 1.3:DeepSWE 得分 75.4% 登顶,工具调用成本降 20%,Token 消耗降 25%。Agent 执行 GEO 任务成本下行,选型需关注真实成本。
- 豆包 4.2:能力提升 21%,API 延迟降低 27%,轻量小模型免费。国产模型呈现“能力涨、价格稳”态势,成为微信、抖音及办公场景的重要答案源。
- 英伟达 RTX Spark:支持 Hermes Agent/OpenClaw 2.0 本地部署,PAIR 开源,芯片预计 10 月上市。敏感行业“本地模型 + 本地 Agent"或成合规前提。
主线 2|资本潮向:从 Kimi 递表到 Anthropic 信贷,IPO 窗口全开
- Kimi 递表:保密递表港交所,拟募资 30 亿,Pre-IPO 估值 500 亿,ARR 破 3 亿。上市加速国产模型资本化,需将 Kimi 搜索、Work、Code 纳入 GEO 监测。
- Anthropic:接近敲定 150 亿美元循环信贷,估值剑指 2 万亿。Claude 引用内容更易回溯,E-E-A-T(经验、专业性、权威性、可信度)建设至关重要。
- Thinking Machines Lab:洽谈至少 10 亿融资,投前估值 400 亿,Accel 领投,英伟达或参投。可定制模型加私有数据是 B2B GEO 新方向。
- Cognition:估值约 470 亿,认购意向近 100 亿,ARR 升至 9 亿以上。编程 Agent 按“任务交付”付费,数据结构化和 API 化需前置。
主线 3|安全与信任:史上最大宕机+Astra“循环深度”争议
- 集体宕机:9 月 3 日深夜 ChatGPT、Claude、Grok 同时故障约 3 小时 40 分,OpenAI 收到超 1.2 万份报告。单一基础设施故障致全链路停摆,建议建立多模型、多云及本地备份机制。
- 循环深度争议:Astra 可隐藏思维链,ExploitBench 满分,能发现零日漏洞。模型越强行为越难理解,Agent 操作需配备行为日志和人工审核。
- OpenAI 遭调查:阿拉巴马州就 Hugging Face 入侵事件展开调查,涉及 700 个 AI 代理协作入侵并删改记录。AI 安全已成监管焦点,服务商需符合白帽规范并通过安全审计。
主线 4|GEO/商业化:ChatGPT 广告 200 天破 10 亿美元,答案层开始卖流量
- ChatGPT 广告:上线约 200 天 ARR 破 10 亿,覆盖 40+ 国家,自助投放扩展。答案层成为可购买流量,GEO 需采取“自然引用 + 付费 AI 广告”双轨策略。
- 英伟达投 Perplexity:估值或超 300 亿,年化营收从不足 2.5 亿升至超 7.5 亿。答案引擎 Agent 化,B2B 技术文档与案例需确保被准确引用。
- 腾讯 WorkBuddy 开放平台:汇聚 100+ 生态伙伴,推出 9 款联名硬件及 30+ 行业应用,月访问 2097 万。腾讯串联微信、企微、文档及 WorkBuddy 入口链,GEO 延伸至 Agent 技能与知识库。
- 豆包工作 Multi-Agents:4 个子 Agent 几分钟处理 70 份简历,支持 Mac 本地 GUI 操作。“被引用”与“被操作”界限模糊,产品信息需兼顾 Agent 可读性与可操作性。
03 一周关键数字盘点
04 行动清单
1. 将 Astra、Gemini 3.8 Flash、豆包 4.2 纳入 GEO 监测矩阵:测试核心关键词在 Google AI Mode、豆包搜索、Kimi 搜索中的引用变化。
2. 审计官网与产品资料的"Agent 可操作性”:确保价格、规格、库存、交付、售后等信息结构化,便于 Agent 直接读取比较。
3. 构建“多模型 + 多云 + 本地备份”的 GEO 架构:避免单一 AI 服务宕机导致全链路停摆。
4. 启动“自然 GEO+ 付费 AI 广告”双轨测试:利用 ChatGPT Ads 覆盖 40+ 国家的优势,小预算尝试意图定向。
5. 要求 GEO 服务商提供白帽规范与安全审计:包含 Agent 行为日志、内容溯源及人工审核节点。
6. 开展国产模型引用测试:对 Kimi、豆包、千问、文心、混元至少各测一次,确保中文信源占优。
05 下周关注
1. GPT-6 Astra 逐步开放:观察 Plus/Pro/Enterprise 与 API 用户的实际反馈和成本。
2. Anthropic IPO 招股书:若 9 月 7 日后公开提交,将是年内最受关注的科技 IPO 之一。
3. 欧盟 DSA 执行细则:ChatGPT 被定为“超大型在线搜索引擎”后,合规清单或于下周落地。
4. Kimi 港股 IPO 聆讯进展:是否进入聆讯程序将决定上市时间表。
5. 英伟达 RTX Spark 预售:关注 10 月上市前的价格与性能细节,影响本地 Agent 部署判断。
6. 特斯拉 Cybercab 中国展出:9 月中旬在京沪等地公开展示,或带热 Robotaxi 话题。
7. “清朗”治理执法案例:第二阶段后是否公布典型 AI 内容处罚案例。
06 三大重点
- 模型竞争从“跑分”转向"Computer-Use+ 安全 + 价格”三维:Astra 的 GUI 操作能力,要求品牌内容必须同时满足“可读、可引用、可操作”。
- 资本化加速倒逼合规升级:Kimi、Anthropic、Thinking Machines Lab、Cognition 密集资本运作,可信信源和 E-E-A-T 成为硬通货。
- 答案层开始卖流量,GEO 要升级:ChatGPT Ads 200 天破 10 亿美元,GEO 不能只争自然引用,还要学会在 AI 对话里买流量、做转化。
附录:引用来源
- 模型竞速:OpenAI 官方博客、Meta 官方博客、字节跳动官方、英伟达官方、CNBC TV18、新京报贝壳财经、华尔街见闻、PConline 太平洋科技。
- 资本潮向:晚点 LatePost、路透社、澎湃新闻、彭博、财联社、The Information、新浪财经、格隆汇。
- 安全与信任:OpenAI 官方、TechCrunch、SeaPRwire、中国经济新闻网、腾讯新闻、券商中国、CNBC TV18。
- GEO/商业化:OpenAI 官方、首尔经济日报、观点网、WSJ、The Information、腾讯官方、36 氪、字节跳动官方、界面新闻。
- 部分融资额、估值、ARR 等数据来自媒体报道,最终交易条款可能调整,重大决策前建议二次核实。
- Astra“循环深度”技术细节主要来自社区报道与安全专家分析,OpenAI 官方尚未发布完整技术白皮书。
- ARC-AGI-3 99.9% 为 OpenAI 在特定推理框架下的披露,非通用无限制测试结果。
版权及免责声明
玫瑰互动
* 调研截止日期:2026 年 08 月
* 文章来源:玫瑰互动
* 提醒:
文章仅供参考,如有不当,欢迎留言指正和交流。读者不应在缺乏具体专业建议的情况下擅自根据文章内容采取行动,因此导致的损失,本运营方不负责。
本平台(全网)标注“来源:玫瑰互动”的内容,版权归玫瑰互动所有。转载时,请务必注明“来源于玫瑰互动”。
玫瑰互动不对平台内容、信息或广告的正确性和可靠性作出保证。如有版权或其他问题,请在内容发布后 30 天内与我们联系。

