1、豆包 2.1Pro 上线火山方舟,飞书 8.0 引入团队智能体
2、生数科技发布 Vidu S2,支持实时编辑与头显适配
3、Claude 重大升级:43 项工作流打通 27 个巨头应用
4、谷歌发布多语言 AI 战略,覆盖全球数百种语言
5、中文互联网基础语料 4.0 发布,120GB 高质量数据上线
6、OpenAI" Lily 项目”曝光,人工审核引发隐私争议
7、vivo 蓝心大模型升级,四大模型实现端云协同
8、Google 官宣 Gemini 3.8 Live,首创“边说边想”交互
豆包 2.1Pro 上线火山方舟,飞书 8.0 引入团队智能体
字节系生产力工具迎来重要更新。火山引擎将豆包大模型升级至 0915 版本并优化 API 接入;飞书同步发布 8.0 版本,正式引入团队智能体“豆包工作伙伴”,推动 AI 应用从个人助手向团队协作演进。

核心亮点
- 模型增强:强化证据溯源与数据核验能力,显著提升复杂任务执行的稳定性。
- 编程升级:多模态编程能力进阶,支持代码仓库深度分析、自动修复及测试。
- 团队协作:新增“豆包工作伙伴”智能体,实现 AI 能力的团队级共享与协作。
生数科技发布 Vidu S2,支持实时编辑与头显适配
生数科技正式发布 Vidu S2 视频大模型系列,涵盖 Avatar(数字人)和 Editing(编辑)两大核心模型。该系列不仅展示了强大的视频生成技术,更率先探索 VR 头显环境下的空间视频生成与编辑能力。

核心亮点
- 高交互数字人:Vidu S2-Avatar 支持语音控制与动态参考图,大幅提升数字角色生成的自由度。
- 实时视频编辑:Vidu S2-Editing 实现视频流实时处理,涵盖风格迁移、虚拟试穿、人物及背景替换等功能。
- 沉浸式体验:拓展 VR 头显空间视频生成与编辑能力,为元宇宙应用提供技术支撑。
Claude 重大升级:43 项工作流打通 27 个巨头应用
Anthropic 对面向中小企业的 Claude 版本进行重大功能迭代,推出 43 项高效自动化工作流,并实现与 27 款主流商业软件的深度集成,旨在将 AI 打造为中小企业的核心业务驱动引擎。
核心亮点
- 效率提升:43 项预设工作流覆盖多场景,助力中小企业大幅降低运营成本。
- 生态整合:深度集成 27 个主流商业软件,构建完整的企业级 AI 应用矩阵。
- 安全合规:强化数据隐私治理与安全机制,全方位保障企业数据安全。
谷歌发布多语言 AI 战略,覆盖全球数百种语言
谷歌发布全新多语言 AI 战略,致力于消除语言障碍,让全球每种语言都能被听见与理解。该战略包含多项突破性技术成果,重点支持低资源语种及无障碍设计。

核心亮点
- 广泛覆盖:技术支持超过 300 种语言,覆盖全球约 86% 的人口。
- 实时口译:推动原生音频智能发展,实现跨 70 种语言的实时口语双向翻译。
- 普惠技术:通过"1000 种语言计划”及开源数据合作,显著提升低资源语种的支持力度。
中文互联网基础语料 4.0 发布,120GB 高质量数据上线
在中央网信办指导下,多家行业单位联合推进的“中文互联网基础语料 4.0"正式发布。该项目收录 120GB 高质量可信数据,为我国大模型训练及人工智能产业的高质量发展奠定坚实数据基石。
核心亮点
- 数据支撑:提供大规模、高质量中文语料,解决大模型训练数据瓶颈。
- 权威指导:由中央网信办指导,行业头部单位联合共建,确保数据来源可靠。
- 产业赋能:120GB 精选数据正式上线,直接助力国内人工智能技术创新。
OpenAI"Lily 项目”曝光,人工审核引发隐私争议
OpenAI 内部代号为"Lily"的项目被曝光,该项目雇佣人工审核员对用户聊天记录进行质量评估。此举虽旨在优化模型表现,但也引发了外界关于用户隐私泄露及知情权的强烈担忧。
核心亮点
- 人工介入:审核员直接查阅 ChatGPT 用户对话记录以进行质量打分。
- 隐私风险:审核过程可能涉及用户敏感个人信息,存在数据泄露隐患。
- 透明度缺失:OpenAI 尚未明确告知用户其私密对话可能被人工审阅。
vivo 蓝心大模型升级,四大模型实现端云协同
在 2026 开发者大会上,vivo 宣布蓝心大模型体系全面升级,发布四大核心模型。新体系覆盖语音理解、端侧感知记忆及云侧任务执行,展现了其在智能体领域的领先布局。

核心亮点
- 语音理解:Blue LM-RealTime 具备强环境适应性,精准识别嘈杂环境、口音及中英混说场景。
- 端侧记忆:Blue LM-Nano 可实时感知并沉淀个人习惯与偏好,实现本地化长期记忆。
- 云侧执行:Blue LM-Flash 与 Pro 通过自研 Agentic 引擎与系统级 Harness 协同,充当跨设备任务中控。
Google 官宣 Gemini 3.8 Live,首创“边说边想”交互
Google 正式推出 Gemini 3.8 Live 及其扩展版本,实现了语音交互领域的范式突破。该模型在低延迟语音流中嵌入了深度推理能力,重新定义了人机语音交互的标准。

核心亮点
- 深层推理:在低延迟语音流中实现多步深度推理,突破传统语音助手限制。
- 边说边想:Extended Thinking 模式支持后台扩展推理,从容应对复杂任务。
- 高阶应用:在实时步骤排错、复杂数理推导等高智力需求场景中表现卓越。

