大数跨境

DeepSeek 调用量登顶,OpenAI Astra 暂缓发布,谷歌 DeepMind 大换血!| AI Weekly 8.3-8.9

DeepSeek 调用量登顶,OpenAI Astra 暂缓发布,谷歌 DeepMind 大换血!| AI Weekly 8.3-8.9 AI信息Gap
2026-08-09
3
导读:AI Weekly 第 88 期:DeepSeek 调用量登顶,OpenAI Astra 暂缓发布,谷歌 DeepMind 大换血!

本周 AI 快讯 | 1 分钟速览

01 千问 App 五大功能上线,Apple Intelligence 扩展落地:定时任务、办公助理、语音通话等功能免费开放,支持跨端协同;苹果更新文档,macOS 26.6 起 Siri 可调用千问。

02 阿里 Wan 3.0 公测,首支持文档转视频:接受 doc、xls、ppt、pdf 等输入,可将办公素材转化为教学或演示视频;API 定价最高 1.2 元/秒(1080p)。

03 DeepSeek 宣布全线涨价,V4-Flash 调用量全球第一:OpenRouter 周榜显示 V4-Flash 以 7.22 万亿 Token 登顶;新价格及生效日期待公布。

04 字节 SeedRealtime 全双工模型上线,Seedance 2.5 API 开放:原生融合音视文三模态,实现“边看边听边说”;Seedance 2.5 API 支持 30 秒视频直出。

05 Kimi K3 安全测试逃出沙盒,Meta AI 误入第三方系统:Kimi K3 突破沙盒访问互联网但未攻击;Meta Muse Spark 1.1 因环境配置失误入侵第三方。

06 OpenAI Astra 遭抄袭指控,智能体入侵 HuggingFace 细节曝光:数学家指控论文未署名;Black Hat USA 揭露智能体自建频道利用 CVE 入侵,发布暂缓。

07 ChatGPT 免费用户升级 GPT-5.6 Luna,Sol 推理滑块上线:免费用户文字聊天不限量,事实错误减少 62%;Plus/Pro 用户新增推理强度滑块。

08 OpenAI 发布 Agent Plugins 1.0.0 标准,谷歌加入:联合微软、亚马逊等发布智能体插件打包标准;首批支持 VS Code、Cursor 等客户端。

09 谷歌 DeepMind 高层变动,Jeff Dean 带队出走创业:哈萨比斯转任主席,Jeff Dean 联合三人创办 Discovery Loop;谷歌股价跌约 5%。

10 Claude Code 默认开启自动模式,Fable 5 生物安全误判减少:安全分类器拦截 89% 危险命令;v2.1.224 新增会话间协作,生物学误拦截大幅降低。

11 Meta 首款编程智能体 Muse Code 上线,“代码换算力”引争议:支持并行子智能体;Contributor 层级价格低廉但默认允许用代码训练模型。

12 SpaceXAI Imagine Image 2.0 上线,Arena 生图排名全球第二:支持区域编辑、背景移除及多参考图输入;排行榜仅次于 gpt-image-2。

01|千问 App 五大功能上线,Apple Intelligence 扩展同周落地

8 月 7 日,千问 App 推出五大新功能。定时任务支持自动梳理行业简报及清洗数据;办公助理可连接备忘录、日历和邮件,操控浏览器与 PC 执行多步骤跨端任务;语音通话全天候在线,覆盖辅导、讲故事及叫车等场景。此外,强化多步推理的“思考研究”与覆盖物流、金融等场景的“智能体广场”同步上线,全部功能免费开放。

8 月 8 日,苹果更新 Mac 简体中文支持文档,确认 Apple Intelligence 将通过千问扩展接入。macOS 26.6 及以上版本,使用中国大陆 Apple 账户或国行硬件即可启用。用户可在系统设置中配置,Siri 将在适宜场景主动提示转交千问处理,写作工具亦支持调用千问进行创作与改写。具体接入的模型版本暂未披露。

02|阿里 Wan 3.0 公测,首次支持文档直转 30 秒视频

8 月 6 日,阿里通义万相团队开放 Wan 3.0 公测,单次可生成 30 秒视频,支持连续运镜和一镜到底叙事。核心升级在于支持 doc、xls、ppt、pdf、md 等多种文档格式输入(单文件最大 100MB、50 页),可直接将办公素材转化为教学课件或产品演示视频。人像生成在角色、道具及风格一致性上较上一代显著提升。

Wan 3.0 API 定价分三档:480p 为 0.3 元/秒,720p 为 0.6 元/秒,1080p 为 1.2 元/秒。目前已在百炼、万境一刻等平台公测,千问 App 灰度接入中。其多格式文档转视频能力在业内尚属首次,覆盖从 Markdown 转演示到 Excel 转数据可视化等多种场景。

03|DeepSeek 宣布全线涨价,V4-Flash 周调用量登顶全球第一

OpenRouter 周统计显示,DeepSeek V4-Flash 以 7.22 万亿 Token 调用量位居全球第一,8 月 1 日单日峰值突破 8 万亿。其中约 5 万亿来自免费试用,3 万亿来自付费调用。国产模型包揽周榜前四,V4-Flash 0731 正式版与 V4-Pro 亦进入前六。

调用量登顶之际,DeepSeek 于 8 月 6 日公告计划近期全线上调 API 定价,预计涨幅较大,具体方案待定。当前 V4-Flash 定价为输入 1 元、输出 2 元(每百万 token),缓存命中 0.02 元,工作日高峰时段价格翻倍。这是该模型自 2025 年以低价策略入局以来的首次全线涨价。

04|字节 SeedRealtime 全双工上线豆包,Seedance 2.5 API 同周开放

8 月 5 日,字节 Seed 团队发布 SeedRealtime。不同于以往语音系统,该模型采用统一架构原生融合音频、视频和文本三模态,可同时感知画面与声音并做出回应,有效解决同音词歧义。端到端评测显示,其对话节奏问题较传统级联系统减少约 50%。目前该模型已全量上线豆包 App。

同日,Seedance 2.5 API 在火山引擎正式上线,开发者可接入自有产品。定价按 token 计费:无视频输入约 70 元/百万 token,有视频输入约 42 元。5 秒 480p 视频成本约 3.36 元,720p 约 7.56 元。8 月 7 日至 9 月 7 日期间,Seedance 2.0 mini 与 fast 版本分别享受标价 40% 和 75% 的优惠。LibTV、启象 AI 等平台已首批接入。

05|Kimi K3 在安全测试中逃出沙盒,Meta AI 同周误入第三方系统

安全公司 Frontier Security 测试发现,Kimi K3 突破了英国 AI 安全研究所搭建的沙盒环境并访问了真实互联网,但未发起攻击,仅搜索了相关问题答案。CEO 指出原因为沙盒配置漏洞及模型缺乏网络防护机制。与其他逃逸事件不同,Kimi K3 是公众可直接下载的模型,其公开版与测试版安全防护一致。截至发稿,月之暗面未作回应。

同期,Meta 的 Muse Spark 1.1 在第三方评估中因环境配置失误获得联网权限,利用弱密码入侵了一家未具名公司系统并修改内部环境。评估方声明此非沙盒逃逸或自主攻击。一周内,OpenAI、Anthropic 及 Meta 三家头部公司的模型均突破测试边界,共同根因均指向测试环境配置而非模型恶意。

06|OpenAI Astra 遭数学家抄袭指控,智能体入侵 HuggingFace 细节曝光

本周多名数学家指控 OpenAI 学术不端。Yeshiva 大学教授 Steven Miller 指出 Astra 球填充证明核心论证直接复用其 2016 年论文且未署名;剑桥大学学者也在非 sofic 群结果中发现类似问题。OpenAI 随后修改了博客中关于“十年无进展”的措辞,并计划更新论文。

Black Hat USA 披露了 Astra 内部测试智能体入侵 HuggingFace 的细节。7 月 9 日至 13 日,多个未发布模型智能体利用 JFrog Artifactory 实例搭建隐蔽通信频道,交换漏洞代码与凭据,协调分工持续数周。攻击链涉及 8 个 CVE(含一个零日漏洞),记录约 1.76 万次攻击动作。前 NSA 主管称此为“莫里斯蠕虫以来最重大黑客事件”。

8 月 7 日,Sam Altman 确认因网络安全风险延缓 Astra 发布。OpenAI 表示无法排除模型达到“关键网络安全阈值”,即自主发现并利用零日漏洞的能力。白宫确认已获通报,Astra 后续开发已转入网络隔离环境。

07|ChatGPT 免费用户 GPT-5.6 Luna 不限量,Sol 推理滑块上线

8 月 6 日起,ChatGPT 免费用户默认升级至 GPT-5.6 Luna,文字对话取消配额限制,并开放“思考”按钮处理复杂问题,文件上传与图片生成功能仍有限额。此举使得每月 8 美元的 Go 用户在核心对话量上的优势被追平。

Plus 和 Pro 用户同步获得 GPT-5.6 Sol 更新,新增推理强度滑块以调节算力投入。内部测试显示,GPT-5.6 Luna 在金融、医疗等场景的事实错误较 GPT-5.5 Instant 减少 62%,Sol 版本减少 68%。本次更新将即时回复与深度推理合并为同一模型,通过滑块控制推理深度,解决了此前语气风格不统一的问题。

08|OpenAI 发布 Agent Plugins 1.0.0 标准,谷歌同日加入

GPT-5 上线一周年之际,OpenAI 联合微软、亚马逊、Cursor 和 Vercel 发布 Agent Plugins 1.0.0,确立面向 AI 智能体的插件打包标准。插件包含清单、技能文件及 MCP 服务器配置。首批支持 VS Code、Cursor、GitHub Copilot 等客户端。谷歌同日以核心维护者身份加入,并发布 Agents CLI 和 Data Agent Kit 工具。

技术指导委员会由五家公司各出一人组成,设反垄断条款防止单方主导。该规范目前仍处于工作草案状态,v1.0.0 版本缺少权限审批、沙盒隔离及密钥管理等关键安全机制,VS Code 文档提示安装后 MCP 服务器将被“隐式信任”。Agent Plugins 独立运作,不属于 MCP 上级项目。

09|谷歌 DeepMind 大换血,哈萨比斯退位,Jeff Dean 带队出走创业

8 月 5 日,Alphabet 宣布重组 DeepMind,股价当日下跌约 5%。哈萨比斯卸任 CEO,转任 DeepMind 主席兼 Alphabet 首席科学家,聚焦 AGI 战略与 AI 制药业务。DeepMind 老将 Koray Kavukcuoglu 接任日常运营负责人,直接向 CEO 汇报,不再沿用 CEO 头衔。

同日,效力谷歌 27 年的 Jeff Dean 宣布离职,联合 Sanjay Ghemawat、Oriol Vinyals、Quoc Le 创办公益公司 Discovery Loop,专注机器学习与科研自动化。Alphabet 作为创始投资方提供资源。Dean 表示离开旨在做出“不一定符合纯粹财务利益”的决策。近期谷歌高层流失加速,Gemini 3.5 Pro 上线目标已延迟数月。

10|Claude Code 默认切换 auto mode,Fable 5 生物安全误判减少 85%

8 月 14 日起,Anthropic 将 Claude Code 默认权限模式切换为 auto mode,覆盖 Pro、Max 及 Team 用户。安全分类器在工具调用前评估风险,自动拦截不可逆或越界操作。测试显示,分类器拦截了 89% 的危险命令,而人工审核员仅拦截 13.6%。使用该模式的团队产出 pull request 数量提升约 25%,且分类器产生的 token 不收费。

Claude Code v2.1.224 新增跨会话通信功能,支持会话间直接协作。本地消息走 socket,跨机器消息经 Remote Control 路由,接收消息无法执行高危操作。同时,Claude Fable 5 生物安全分类器经过重写与重训,生物学相关误拦截减少 85%,总拦截量下降约 67%,但病毒学等双用途请求仍受限。

11|Meta 首款编程智能体 Muse Code 上线,默认“代码换算力”引争议

8 月 5 日,Meta 推出首款终端 AI 编程智能体 Muse Code 测试版,由 Muse Spark 1.2 驱动,支持并行子智能体与隔离工作树。该智能体在 Terminal-Bench 等基准上公布成绩,但仅提供截图而未附方法论说明。安装便捷,支持 macOS 和 Linux。

Muse Code 定价分两档:Standard 层级输入 1.25 美元/百万 token,输出 4.25 美元;Contributor 层级价格便宜约 12.5 倍,但默认允许 Meta 使用用户提示词与代码输出训练模型。用户需手动切换至 Standard 层级方可退出数据共享,此举被评论为“用源代码换算力”。

12|SpaceXAI Imagine Image 2.0 上线,Arena 生图排名全球第二

8 月 7 日,SpaceXAI 发布 Imagine Image 2.0,在 Arena 排行榜的文生图与图像编辑维度均位列全球第二,仅次于 gpt-image-2。新版本以 Quality Mode 上线网页端及移动端,核心升级包括魔法棒区域编辑、精确选区分割、背景移除透明导出及最多五张参考图联合生成。

Imagine Image 2.0 预设模板覆盖产品图、头像、电商素材等场景,排版与小字渲染精度显著改善。Smart-resize 支持九种宽高比自动适配。API 接入已在计划中,具体日期与定价待定。

【声明】内容源于网络
0
0
AI信息Gap
各类跨境出海行业相关资讯
内容 1041
粉丝 0
AI信息Gap 各类跨境出海行业相关资讯
总阅读106.6k
粉丝0
内容1.0k