大数跨境

中国AI大模型平台排行榜 | 8月

中国AI大模型平台排行榜 | 8月 AI大模型工场
2026-09-14
4
导读:大模型工场榜单




作者参商 西梅汁

编辑|星奈

媒体|AI大模型工场








国内大模型发展趋势|8月份解读



巨头们如何瓜分企业级AI办公蛋糕?


8月企业级AI办公最值得关注的变化,是巨头们开始集体拆掉AI和企业软件之间的那堵墙。过去AI办公更像一个外挂:写文档、总结会议、做PPT,效率确实提高了,但真正进入复杂工作之后,人还是要在企微、钉钉、飞书、网盘、业务系统之间来回切换。现在这轮竞争,已经明显从“AI帮你做一件事”,走向“AI直接进入你原来的工作环境”。


所以最近几家的动作看起来不同,背后的目标其实高度趋同。千问办公不断接入企微、钉钉、飞书,豆包工作把连接器和Skill扩到200多个,WorkBuddy则把Skills、企业知识、权限体系和腾讯办公生态串到一起。大家都在解决同一个问题:企业不会为了用AI推翻现有的软件体系,AI只能主动去适配企业。谁能连接更多系统、读懂更多数据、继承原来的权限关系,谁才更可能从一个办公工具,变成横跨多个软件的工作入口。


当然,仅仅靠“连得上”还不够,AI到底能不能把事情做完同样重要。豆包工作不断补Skill,WorkBuddy强调任务拆解、本地文件和企业系统调用,本质上都是在提高Agent的执行能力。以前的软件逻辑是“人操作工具”,现在正在变成“人提出目标,Agent调用工具”。这也是企业办公里一个很重要的分水岭:未来企业采购AI,看的可能不再是它会不会写一篇漂亮的报告,而是能不能自己找资料、调用工具。


从这个角度看,企业级AI办公正在逐渐形成一个更清晰的竞争系统、跑流程,最后交出一个可以直接使用的结果。


和对手主攻系统互联不同,库库AI把发力重心放在金融等高知识密度的专业场景。企业越往深处走,决定AI好不好用的就越不是通用能力,而是它懂不懂这个行业的资料、术语、流程和判断逻辑。金融研报、财务模型、行业数据库这些东西,本身就是一道门槛。换句话说,企业AI办公卷到最后,拼的不是谁功能最多,而是谁能掌握更多企业真实上下文,以及更难复制的专业知识。


第一阶段是把AI放进办公软件,第二阶段是让AI跨软件流动,第三阶段则是让AI真正接管一部分工作流。阿里、字节、腾讯、百度现在看似路线不同,其实都在往第三阶段靠近。真正的大蛋糕,也不只是Office软件本身,而是企业里大量原本由人完成的搜索、整理、沟通、分析和执行工作。谁能率先把这些工作重新封装成Agent可以稳定完成的流程,谁才更有机会拿到企业AI时代真正有价值的入口。



国产大模型进入“月更时代”


8月的大模型圈,有种明显的“换挡感”。


Qwen3.8-Max、混元Hy4 preview、GLM-5.3、Kimi K3接连上线,DeepSeek也在继续更新V4 Pro和Agent框架。模型发布越来越密,旧模型退场也越来越快。最典型的是Kimi K2.5,今年1月才发布,到8月底就正式退役,前后不过7个月。


过去大家习惯说“大模型一年一代”,现在这个节奏显然已经不太够用了。模型能力、产品形态、Agent需求都在一起往前跑,一款旗舰模型刚把能力推上去,下一轮竞争很快又开始。国内大模型正在进入一个更高频的迭代周期,“发新模型”本身已经不算新闻,能不能持续跟上这一轮能力跃迁,反而成了新的门槛。


另一个变化,是开源越来越舍得下本钱了。阿里在宣布开放Qwen-Max级模型权重,又继续开源Qwen3.8-27B;腾讯Hy4 preview直接用Apache 2.0协议开放,同时还把0.5B到7B的小模型矩阵补齐;智谱GLM-5.3和GLM-5.3-Flash同样延续开源路线。


这和前两年的开源已经不太一样。以前不少厂商更愿意把最强模型留在API里,开源更多承担拉开发者、刷生态存在感的作用。到了现在,旗舰级模型也开始往外放。原因并不复杂:当模型能力越来越接近,仅仅把模型锁在自家平台里,很难形成足够大的优势。反而是先进入开发者工具、Agent框架、云平台和企业应用,才更容易把模型真正变成生态入口。


Qwen系列累计开源超过460个模型、全球下载量突破30亿次;Kimi K3发布后进入GitHub Copilot;GLM-5.3上线后,也很快被第三方模型平台适配。模型厂商现在抢的,已经不只是榜单上的几个百分点,而是谁能成为更多开发者和Agent优先调用的那一个。


再看这些8月新模型重点强化的方向,也能看出风向变了。长上下文、Coding、工具调用、任务规划、持续执行,几乎成了共同关键词。Hy4 preview重点强化复杂任务中的规划和工具调用,GLM-5.3把长程软件工程与Agent能力放在核心位置,DeepSeek V4 Pro也在持续补强Agent,并把Harness框架直接开放出来。


某种程度上,大模型正在从“陪你聊天的大脑”,变成“给Agent干活的发动机”。以前比的是回答一道题能不能多拿几分,现在更看重模型能不能连续工作、调工具、处理复杂任务,最后把事情真正做完。Agent开始进入实际工作场景之后,对底层模型的稳定性、上下文长度、推理和执行能力都提出了更高要求,模型迭代自然也被进一步推快。


在这波密集发布的背后,更值得看的其实不是“又多了几个新模型”,而是国产大模型正在慢慢形成一套新的竞争方式:旗舰模型不断冲上限,小模型往端侧走,开源负责铺生态,Agent负责把能力转成真实使用。


当顶级模型越来越容易获得,单纯拥有一个“好模型”反而没以前那么稀缺了。接下来真正难的是,模型能被更多人用起来,进入更多Agent、更多企业系统,最后变成持续增长的Token消耗和真实收入。模型战争没有降温,只是战场正在从参数榜单,往生态和应用更深处移动。



机器人行业开始换考题了


8月的机器人行业,最明显的变化不是机器人又跑快了多少,而是大家开始换一套评价标准。


WRC第一次单独设立“采购日”,同时把开发者日、真实场景试用放到更重要的位置;紧接着举行的世界人形机器人运动会,51个项目里直接安排了21个场景赛,把机器人塞进家庭、酒店、工业、应急、商超等真实环境里。 


展会开始问“谁愿意买”,比赛开始问“你到底能不能把活干完”。以前机器人做个后空翻、跑个百米,很容易成为全场焦点;现在任务完成率、连续运行、异常恢复、部署成本这些没那么性感的指标,反而越来越决定一家公司的真实含金量。比如银河通用家庭场景全自主完成任务、星海图把前置仓整套拣选打包流程搬进展馆,本质上都在回答同一道题——机器人能不能从一个漂亮Demo,变成一份真正可以交付的“劳动力”。


而当行业真的开始考虑“上岗”,人形也就没必要非得长得像人了。


过去两年大家谈具身智能,很容易默认“通用机器人≈双足人形”,但今年WRC展会上,轮式、轮臂、双足、四足已经明显开始分流。银河通用、星海图、自变量、星尘智能都在用不同形态寻找自己的工作场景,同一家公司内部甚至同时布局几种身体。 


仓库地面平整,轮式方案就是比双足更省电、稳定性更强;园区巡检,四足的地形通过性更占优势;只有面对楼梯、居家复杂杂乱环境这类人类生活空间,双足人形的价值才真正释放。从各家产品布局能读出思路反转:不再先造一台最像人的机器人,到处找能用的地方;而是先锁定具体工作岗位,再决定机器人该是什么形态。通用智能,并不一定需要一种通用身体。


再往展台背后看,8月还有一批过去不太抢镜的东西正在迅速升温:数据、世界模型、触觉、仿真和操作系统。


大晓本次参展没有把重心放在整机表演,而是集中展示世界模型、数据采集工具与场景方案的组合;千觉重点展出整手触觉数据接入多模态模型的实测效果;自变量的核心展出看点,就是如何压低真机大规模数据采集的成本;星尘智能则把世界动作模型和具身操作系统作为本次对外输出的核心。


与此同时,灵巧手、力传感器、关节模组等上游零部件厂商在 WRC 的曝光度明显抬升,不再是角落里的配角。业内将WRC视作一次产业链协同的摸底考试,也恰恰来自这些参展动态:具身智能很难再靠某一家整机厂大包大揽完成全部环节。机器人走向真实业务,需要一整套配套基础设施:视觉做环境感知、触觉做接触反馈、真实数据做迭代养料、世界模型做环境预判、仿真完成低成本试错,再靠操作系统与调度系统管理几十上百台设备。


人形机器人的 iPhone 时刻还没有到来,但围绕它的底层软件、工具链、生态,各家已经开始卡位竞速。


世界人形机器人运动会也越来越不像单纯的机器人“奥运会”,更像一个公开测试场。


本届赛事 666 支队伍、2056 台机器人参赛,21 项场景赛全部脱胎于九类真实业务需求,考核的是长流程完整业务逻辑,而不是碎片化动作。家庭组别里,机器人不是简单抓取一件衣服,而是连贯完成取衣、整理、晾晒,中途还会插入随机突发任务,银河通用就是依靠全程无人工介入的全自主流程拿到家庭场景冠军。


对行业来说,这种比赛的价值可能比刷新一项百米纪录更大,因为机器人会在公开、随机、不可完全预设的环境里暴露问题。以前一家公司关起门来做Demo,很难知道自己的能力到底处在什么位置,现在这些比赛正在慢慢形成一套更接近真实生产力的Benchmark。


整个8月份,国内具身智能真正发生的变化,可以总结成一句话:行业正在从“证明机器人很厉害”,走向“证明机器人有用”。


订单、融资、新品发布依旧重要,但从银河通用、星海图到大晓、自变量、星尘智能的实践来看,下一阶段市场会持续追问更现实的问题:机器人每天有效工作时长有多少?任务能不能稳定连续闭环?换工位是否要重新采集数据、重新训练?遇到异常能不能自主恢复?从小批量十几台扩产到上千台,需要多少运维工程师?客户第二年是否愿意持续复购?


当这一系列问题,慢慢盖过“会不会跑跳、纸面参数有多高”的讨论,具身智能才算真正走出Demo时代。这也是8月两场行业活动最大的意义:产业热度仍在,但考题已经从秀技术,变成实打实交落地作业。




国内大模型动态



字节跳动


8月31日,消息称,字节近期召开豆包股说明会,对豆包股相关员工出台新政,包括上调豆包股价格,从6月的14.85美元/股调整至17.02美元/股,涨幅约14.6%。


消息还提到,字节增加豆包股的发放,每人情况不同,部分员工可达总包的5%左右。


员工可选择调整豆包股比例,把总包中的现金换成豆包股,每人受职级等因素影响满配比例不同,比例包括20%、30%等档位。豆包股的兑换方面,每人额度不同,比如部分L2、L3员工可选的豆包股满配比例是20%;部分L3、L4员工满配比例则是25%、30%。


8月26日,即梦AI正式推出影视内容厂牌“即梦片场”,面向电影、剧集项目开放征集,入选项目将获得算力、技术、资金、行业资源等多维支持。电影项目面向时长90分钟以上、目标为院线上映或网络平台发行的影视项目;剧集项目则面向连续性剧集或单元剧,作品可发布于长视频或短视频平台。电影项目设S级、A级两档,支持内容包括制作积分、模型权限、技术测试、版权保护、1v1技术指导等。其中,S级项目可获得全额覆盖项目需求的制作积分和最高算力通道,并由产研团队协作深度共创;A级项目可获得每分钟最高25万积分及优先算力通道。


8月25日,豆包正式发布了面向生产力场景推出的 Agent 产品与品牌——豆包工作。用户可通过豆包工作电脑版独立应用、豆包电脑版等入口使用,并随登录或更新赠送30天免费订阅权益。


据了解,豆包工作支持文档、表格、PPT、图片、视频、网页和应用等多种内容生成及编辑,在同类产品中已颇具竞争力。同时也提供了“指哪改哪”的 AI 协作编辑能力,用户可对任意内容定点修改、持续打磨,而不是反复重新生成。既节省算力消耗,也提升了完成速度


8月24日,字节跳动完成旗下办公AI产品团队整合,TRAE、扣子团队整体并入豆包体系。具体安排为:TRAE Work、扣子将与豆包在工作场景的产品能力进行整合;TRAE IDE及CLI将作为豆包品牌下的编程产品线持续发展。调整后,以上产品和运营团队向豆包产品负责人赵祺汇报。加上7月底已并入豆包的飞书产品团队,字节旗下所有生产力Agent相关团队完成统一。


字节方面回应称,此次调整旨在更好地协同产品和技术资源,为用户提供更优质的AI工作体验,现有用户权益不受影响。


8月21日,豆包 PC 客户端 "工作任务" 模式迎来重大更新,正式上线技能、连接器、工作伙伴(工作小队)三大全新能力,功能入口位于 PC 版侧边栏。


豆包内已上架超 200 个技能,覆盖数据分析、内容策划、科研、金融等专业方向,支持自定义新建技能,把常用工作步骤、交付标准和参考模板整理成可反复使用的流程。


通过用户授权机制实现豆包与第三方办公平台的双向数据打通,目前支持飞书、钉钉、企业微信、腾讯会议、邮箱、财经平台等 10 + 主流系统,可直接读取、写入文档表格,自动完成信息拉取、资料归档、数据同步。权限跟随用户,操作全程可追溯。


用户可根据实际需要选择不同专业方向的 Agent,协同分析问题、拆解步骤并完成交付,从单一助手走向多 Agent 组队协作。这一更新为几天后 "豆包工作" 独立品牌的发布奠定了功能基础。


8月19日,字节跳动的大模型部门 Seed 已于上周完成了新一轮的组织调整。其中最关键的部分是 Seed Foundation Model (Seed 基础模型)成立了四个新的一级部门: Pretrain Data,负责人李成刚。由原先分散在文本模型、编程、视觉理解和语音等方向的预训练数据团队合并而来,统一负责新 Omni 模型的多模态数据,以及超大模型预训练所需的数据工作。


Horizon RL,负责人唐晟宇。整合了此前散落在后训练、推理和视觉理解的后训练团队,主要负责强化学习,提升模型的基础智能上限。


Product Posttrain-Work,负责人秦禹嘉。新部门主要服务 B 端应用,负责 Agentic 模型的整合与发布,并针对办公场景优化模型的 Agentic 能力,包括支持豆包和 Dola 的任务模式。


原本由朱文佳负责的 Application 团队继续保留,并更名为 Product Posttrain-Chat,主要服务 C 端应用,负责对话模型的整合与发布,与 Product Posttrain-Work 分工协作。


四个新部门的负责人均向吴永辉汇报。此外,Seed 还为 AI 安全及其他前沿探索方向分别任命了负责人。


8月11日-8月13日,多个信源确认,字节跳动正式成立 AI 数据与安全一级部门,与 Seed、Flow、抖音等业务平级,这是字节继 Seed(大模型研发)、Flow(AI 应用)之后的第三个 AI 一级部门。负责人为王赢磊(Adam Wang),此前长期负责 TikTok 业务,先后担任 TikTok 平台责任负责人和 TikTok 直播负责人。


新部门核心职能是为所有大模型提供跨模态数据服务,覆盖数据标准制定、寻源采购、合成清洗和质量评测。其组建整合了此前分散的多个数据团队,包括 Global Data、集团数据中台 DMC 和 Flow 下属 AIDP。此前负责字节 AI 数据体系建设的傅越(Yuyi)被曝将于近日离职。该部门的成立标志着字节将数据基础设施提升到与模型研发、应用落地同等的战略优先级。


8月5日,字节跳动 Seed 团队正式推出原生音视频全双工大模型 SeedRealtime,并宣布该模型已在豆包 App 全量上线,在业界率先实现音视频全双工技术的规模化落地。用户将豆包 App 更新至最新版本,在对话框内选择 "打电话" 进入视频通话界面即可体验。


SeedRealtime 采用统一端到端架构,原生融合音频、视频与文本三种模态信号,与此前业界主流的级联系统不同。端到端人工评测结果显示,相比级联模型,SeedRealtime 在对话节奏上的问题减少了一半,抢话、回应迟缓、被杂音打断等卡壳现象明显减少,带来 "边看、边听、边说" 的自然交互体验。



腾讯


8月31日,腾讯混元发文称,自2026年8月28日混元Hy4preview在WorkBud-dy首发接入以来,凭借着其Agent能力的显著提升,受到了广大用户与开发者的积极体验和热情反馈,上线首日即在WorkBuddy任务队列中出现排队情况,对此深表歉意。


为保障使用体验,公司已针对Hy4preview推理集群进行紧急扩容,并将持续动态调配资源。但受限于高端算力总量与高峰并发集中,仍不排除个别时段会继续出现排队情况。


8月28日,腾讯混元发布并开源新一代大语言模型 Hy4 preview,这是继 Hy3 正式版之后腾讯推出的新一代大模型,也是 8 月份最重磅的 AI 动态。Hy4 preview 总参数 770B、激活参数 49B,上下文长度突破 1M(最大输入 960K、最大输出 64K),采用 Apache 2.0 协议全开放。重点面向 Agent、Coding与生产力场景优化,强化复杂任务中的理解、规划、工具调用与持续执行能力。在模型尺寸、上下文长度、数据规模上均较 Hy3 实现跃升。


此次发布没有开发布会,只有一篇文章加一个开源仓库,延续了腾讯混元 "深夜放货" 的风格。WorkBuddy国内版与国际版实现首发接入,同时宣布Hy4 preview 开启为期两周限时免费体验,上一代 Hy3 免费使用期延长。编码能力跃升至全球第 6。摩根士丹利基于腾讯在 AI 领域的强劲进展,维持相关评级。腾讯WorkBuddy生态发布会定于9 月2日14:00在深圳举行。


8月19日,微信迎来一波密集的功能更新,原生 AI 助手 "小微" 灰度测试新增 3 个高频场景入口,使微信内的 AI 入口总数达到 16 个。小微由 WeLM-80B 定制化模型驱动,可实现对话问答、信息检索、调用微信基础功能、唤起各类小程序服务等操作。用户可通过语音或文字指令完成发消息、转账、设置提醒、群聊总结、朋友圈管理等操作,关键操作(如转账、支付)仍需用户手动确认。


美团京东、携程、得物等头部平台已宣布接入。预计 2026 年第三季度向所有用户全面开放。与此同时,语音转文字、批量撤回、图片处理等基础体验也同步优化。


8月13日,腾讯 WorkBuddy发布5.3.11版本,资料库能力迎来重大升级,首次打通AI生成、数据存储、协同编辑与网页发布。


升级后用户无需代码基础,通过自然语言即可生成具备数据存储能力的网页、数据看板与轻量工作台。HTML 编辑可像Word文档一样直接修改,页面与CSV表格数据实时双向同步;支持人机协同编辑、Markdown文档也上线了AI审阅功能;成品可一键发布为在线链接。同时产品实现桌面与移动端任务进度全同步,支持跨设备接续工作。


按DAU计,WorkBuddy已是国内最受欢迎的效率智能体工具之一,率先覆盖Win、Mac、鸿蒙、安卓等主流操作系统,并持续与腾讯文档、腾讯ima等生态产品深度协同。


同时,WorkBuddy资料库全面升级,这是一个更好地让AI理解、编辑和使用的资料管理空间。在资料库里,可实现HTML、智能Markdown等AI原生文档协同编辑和人机双写,提供更顺畅办公协同体验;同时上线“轻应用”功能,给用户制作能存数据的HTML,发布可同步数据的工作台或工作看板。


8月13日,腾讯会议升级发布了AI录音笔,并且升至了首页的四大金刚位一级入口,可以完整的留存线下的沟通资产,并且和WorkBuddy打通,让agent可快速调用线下会议Context,让agent也更懂个人的办公需求。


8月12日,腾讯发布2026年第二季度财报,AI投入成为最大看点。报告期内,腾讯实现营收2047.85亿元,同比增长11%;Non-IFRS经营利润756.4亿元,同比增长9%,若剔除AI相关产品影响,利润增速可达19%。AI相关产品投入从第一季度的88亿元进一步上升至第二季度的105亿元,资本开支达527.8亿元,同比大增176%、环比增长65%,自由现金流为-138亿元(剔除算力采购预付款后为376亿元)。多家机构预测,腾讯2026年全年资本开支将超过2000亿元。


在AI业务进展方面,混元Hy3按OpenRouter token消耗量持续位列全球前三,更大参数的Hy4正在训练中、预计年内发布;AI办公助手WorkBuddy与编程助手CodeBuddy6月用户数达2750万,WorkBuddy月访问量突破2000万次;微信内AI智能体"小微"已启动小规模原型测试,定位为生态调度型智能体。


马化腾表示"正在智能、应用与基础设施三个层面构建全新的AI赋能腾讯",刘炽平则称"微信将成为以AI为先的生态系统",预计"小微"最早可能在第四季度全面公开测试。


8月4日,腾讯混元宣布开源四款小尺寸模型,参数规模分别为 0.5B、1.8B、4B、7B。四款模型主打端侧部署与 Agent 能力,面向低算力设备和嵌入式场景,允许开发者在本地设备上运行轻量化 AI 能力,进一步完善混元从云端旗舰到端侧轻量的全尺寸模型矩阵。同日,CodeBuddy Code v2.81.0 发布,新增 5 个全局快捷键、统一 Toast 通知系统、全局错误边界及工具进程折叠等功能。



阿里


8月27日,千问办公26日晚首发上线刚刚发布的Qwen3.8-Flash模型,同时推出标准模式。即日起,所有用户可通过全新的标准模式体验Qwen3.8-Flash。基于最新的模型,用户可以用更少的积分消耗、更快的Token吞吐速度完成任务。未来,千问办公的模型供给将只有标准和高级两种模式,95%的日常任务通过千问办公标准模式即可完成,仅5%的复杂任务需要使用高级模式。


同日,阿里发布全新Qoder,这是一款以Coding为核心能力,面向所有人的智能体工作台。


全新Qoder采用更加简洁、以任务为中心的用户界面。用户不必从代码开始,只需用自然语言描述目标,Qoder即可调用Coding和工具能力,完成开发、原型制作、数据处理等任务。全新Qoder延续了Qoder过去一年在AgentHarness上的积累,内置包括Qwen3.8-Max在内的多款前沿模型,并提供Auto智能调度能力。


Qoder还支持40多个连接器、70多个插件和2万多个技能,提供编程、通用两种模式,新增桌面宠物和实时语音等能力。目前,Qoder已服务全球超过600万用户和超过10万家企业客户。


8月26日,阿里巴巴旗下Agent产品“千问办公”国际版(QwenWork)开启公测。即日起,海外个人和企业用户可通过国际官网(qwenwork.ai)体验,目前网页版和PC客户端已开放。


8月25日,阿里AI应用搭建产品Meoo(秒悟)近日打通了自然语言做App的全链路。不懂编程的普通用户只需用自然语言描述想法,Meoo即可自动生成页面与功能,支持真机测试、持续修改与一键打包,最终产出可直接安装使用的原生应用,覆盖安卓与iOS双端。“一个想法”到“一款应用”之间的门槛被大幅拉低。


8月23日,阿里巴巴公告拟向非美国合格机构投资者配售新股,募资总额约 800 亿港元。这是阿里自 2019 年在港股上市以来首次通过配售新股融资,创下港股历史上规模最大的后续股票发行纪录,也是 2026 年以来全球第三大同类交易(仅次于 Alphabet 和英特尔)。


阿里明确表示,扣除相关费用后的净募集资金将 100% 投入 "全栈 AI 能力",覆盖 AI 芯片、基础设施以及 AI 模型的开发和部署等领域,不用于电商扩张、并购或股票回购。消息传出后据传已获得超额认购,主权基金等长线机构积极参与。


8月22日,阿里巴巴下属人工智能应用“通义”App 完成品牌升级,正式更名为“千问”,版本号从 3.60.0 直接升级至 5.0.0。通义千问、千问 2C、千问办公等品牌整合为“千问”统一品牌。此次更名与阿里 AI 业务架构调整同步推进,8 月 20 日阿里宣布将千问和 AI 实验室合并为“AI 实验室与应用”板块,AI 业务从技术中台升级为独立业务。


8月20日 ,阿里巴巴发布 2027 财年第一季度财报。集团总收入 2689.53 亿元,同比增长 9%。AI 商业化全面加速:阿里云外部商业化收入同比增长 45%,增速创 22 个季度新高;AI 相关产品季度收入达 123.76 亿元,连续第 12 个季度实现三位数同比增长;AI 相关产品年化收入(ARR)突破 495 亿元人民币(约 73 亿美元),在阿里云外部商业化收入中占比升至 35%;新划分的 "AI 云与算力服务" 分部收入 484.37 亿元,经调整 EBITA 同比大增 133% 至 56.28 亿元,利润率升至 12%;"AI 实验室与应用" 分部收入 33.38 亿元,同比增长 16%,但亏损有所扩大。


CEO 吴泳铭在财报电话会上表示,AI 已成为阿里云加速增长的核心引擎,预计下一季度 AI 相关收入将继续保持强劲增长。千问 App 月活突破 3 亿,近 1.4 亿用户通过它首次体验 AI 购物。


8月19日,Gartner发布2026年《Magic Quadrant for Desktop as a Service》报告,阿里云凭借无影AI云电脑入选“领导者”象限,连续第四年入选该报告,并且首次跻身全球“领导者”象限,成为全球唯一完成“三级跳”的云厂商。


Gartner在报告中指出:“DaaS市场正在超越传统的虚拟桌面交付,逐步融入人工智能。”阿里云无影依托AI原生能力、GPU算力调度与生态集成三大优势,面向Agent等场景推出Agentic Computer产品,提供完整桌面环境与7层安全闭环,支持企业现有软件无缝运行。


Gartner 预测,到2030年全球20%的DaaS工作空间将服务于AI智能体,市场规模将从2026年的49亿美元增长至65亿美元。


8月18日,阿里旗下Agent产品“千问办公”正式接入企业微信。


此前,该产品已接入钉钉和飞书。至此,“千问办公”实现国内三大主流协同办公平台的全面支持。用户进入“千问办公”连接器,按照页面提示完成企业微信账号授权和必要配置后,无需单独安装或使用命令行工具,即可直接通过对话调用企业微信相关能力,如读取智能表格、新建和读写文档、发送通知、查询日程、预约会议或创建待办等。目前,该功能已在网页端开放,客户端入口也即将上线。


8月17日,阿里巴巴正式发布AI音乐模型 HappyShrimp(中文名“快乐虾米”),产品海内外同步上线。


该模型采用端到端整曲生成技术路线,可基于自然语言描述独立完成作词、作曲、编曲、演唱全流程创作。不同于传统工具依赖专业音乐标签,HappyShrimp支持情绪、场景、叙事等生活化表达输入,同时可准确把控曲风、人声、BPM等多维专业指令,在降低创作门槛的同时保障作品完成度。


发布当日,HappyShrimp宣布与太合音乐集团达成战略合作,未来,双方将围绕音乐产业生态共建、AI音乐平台合作及音乐人共创等方向展开深入探索,共同拓展AI音乐创作与产业发展的新可能。8月28日至30日,HappyShrimp还将亮相2026阿那亚·虾米音乐节,并以虾米音乐节为灵感创作现场氛围音乐。


8月17日,阿里云通义千问正式开源 Qwen3.8-27B 模型,采用 Apache 2.0 协议可免费商用。该模型为 270 亿参数的原生视觉语言 Dense 模型,压缩后约 17GB,一张 24G 显卡即可本地运行。重点提升了文本和视觉模态下的编程与办公场景能力,能更可靠地端到端完成复杂任务。开源三天下载量即突破 300 万次。至此,通义千问系列已累计开源超 460 个模型,全球下载量突破 30 亿次,超越 Meta 和谷歌,成为全球开源大模型 "第一家族"。


8月14日,阿里云通义千问正式开源 Qwen3.8-27B 模型,采用 Apache 2.0 协议可免费商用。该模型为 270 亿参数的原生视觉语言 Dense 模型,压缩后约 17GB,一张 24G 显卡即可本地运行。重点提升了文本和视觉模态下的编程与办公场景能力,能更可靠地端到端完成复杂任务。开源三天下载量即突破 300 万次。至此,通义千问系列已累计开源超 460 个模型,全球下载量突破 30 亿次,超越 Meta 和谷歌,成为全球开源大模型 "第一家族"。


8月13日,阿里巴巴正式开源Qwen3.8-2.4T-A95B旗舰大模型,采用稀疏 MoE 架构,总参数 2.4 万亿、每步激活约 950 亿参数,原生支持 256K 长上下文,在 GPQA Diamond、PaperBench 等权威基准中达到全球第一梯队水平,性能对标海外旗舰闭源模型,是行业首次将 Max 级别的大模型能力完全开源。


8月12日,阿里云灵骏真武 M890 超节点实例正式上线,首批在乌兰察布地域开售。灵骏真武M890超节点是国内首个成功运行超2万亿参数大模型的超节点形态算力,Kimi K3和Qwen3.8-Max均已通过该实例对外提供服务。


该超节点实例支持FP8/FP4低精度计算,通过ICN Switch 1.0芯片将Scale-up互联规模由16卡拉升至64卡,卡间互联达800GB/s。在智能驾驶、具身智能等训练场景中,相比上一代真武810E训练性能提升3倍。


本次超节点实例首发地域乌兰察布是阿里云五大超级数据中心之一,绿电占比约90%,可为高密度算力提供更低碳的运行环境。


8月12日,千问AI平台上线“千问AI Arena”。这是一个面向AI Agent的挑战与评测平台,从真实业务中产生挑战任务,为开发者提供模型、运行环境和评测能力,征集并验证能解决实际问题的Agent方案。首个任务由千问AI平台与Aidge联合发起,聚焦跨境电商商品上架场景。千问AI Arena推出Agent机器评测能力,与专家评审相结合。机器评测引擎覆盖文本、图片、视频等多模态内容的业务场景契合度分析,预计8月中旬启动自动化评测并打榜。


8月11日,千问开放平台现已上线,同步支持 APP、PC 与 AI 眼镜三端。在眼镜端,千问提供技能平台和行业定制两大模块。


在技能平台上,开发者可以调用已开放的眼镜能力,结合特定场景和人群需求创建Skill。此外,开发者还可调用眼镜拍照、语音交互等能力,通过自然语言创建Skill,打造导游、教练等特定领域的随身AI助手。同时,千问开放平台正在陆续开放更多AI眼镜能力,包括空间3D立体显示、运动健康状态感知等,进一步拓展开发空间。


8月10日,基于首创全模块化设计架构,阿里云已将大型AIDC数据中心的交付工期缩短至100天。在缩短工期的同时,阿里云数据中心整体建设成本降低10%以上。今年,阿里云计划将模块化数据中心的全球产能提升两倍以上。


8月7日,千问宣布功能上新,推出思考研究、定时任务、办公助理、语音通话、智能体广场等多项新功能,并同步支持最新旗舰模型Qwen3.8-MAX。


其中,“思考研究”模式在原有深度思考基础上进一步强化复杂推理与结构化输出等能力;“定时任务”支持预设时间自动完成行业简报梳理、邮件分类等周期性工作;“办公助理”可连接备忘录、日历、邮件等应用,自主完成数据清洗、文档整理等多步骤任务并交付成品。


同时,千问新增语音通话能力,支持7×24小时在线陪伴及多场景语音交互;智能体广场首批上线覆盖物流、房产、理财、汽车等十多个领域的智能体服务。千问还支持手机与PC跨端协同,可在手机端发起任务、电脑端执行。


8月7日,阿里巴巴正式推出国内首个一站式AI语音生产力平台CosyVoice Studio。该平台基于阿里自研语音模型Qwen-Audio打造,含有三个主要功能,其中语音键盘能够把说完的话变成去掉口语填充词逻辑更清晰的结构化文本,音频内容创作工具能把用户想讲的内容变成播客和有声书,语音智能体能够根据企业需求创建实时对话的语音智能体。该平台可全面满足企业、开发者和用户的AI语音需求。


8月5日,阿里千问正式上线 Qwen-Image-3.0 图像生成大模型,标准版与旗舰 Pro 版同步开放商用 API。国内用户可直接接入千问平台,海外用户依托 Qwen Cloud 调用,基础文生图单价低至 0.18 元 / 张。该模型综合实力稳居国内第一梯队,在 Arena.ai 国际文生图榜单中位列国产模型榜首,核心优势集中在超长文本理解与复杂场景生成。上线当天即冲上 Hugging Face 榜首。


8月3日,阿里巴巴一日内三箭齐发。正式发布新一代基座大模型 Qwen3.8-Max,总参数量达 2.4 万亿(2.4T),激活参数 95B,支持 100 万上下文 Tokens,为千问系列尺寸最大、性能最强的旗舰模型。基于 Qwen 3.5 架构构建,在编程(Coding)、办公(Cowork)、科研及长周期任务方面全面提升,权威三方榜单 Arena 中整体性能处于全球大模型第一梯队。API 同步上线千问 AI 平台,并宣布将于下周开源权重 —— 这是 Qwen-Max 级模型首次开放权重。


同日,企业级 Agent 产品 "千问办公"开启公测,整合了旗下 QoderWork、MuleRun、悟空三款产品的核心能力,是业界首批将桌面智能体、云端智能体与企业协作智能体融于一体的平台。用户可通过官网体验,网页版和独立 PC 客户端先行开放,钉钉端后续接入。核心理念是 "不止于对话,更注重交付"—— 一句话即可完成数据分析、PPT 生成、视频剪辑、网页搭建等复杂任务。


此外,阿里云在 2026 世界人工智能大会(WAIC)上发布智能体原生创新成果。



百度


8月20日,百度 AI Day 第二场专场活动举行,百度 APP 集中发布多项重大产品升级,核心功能全部免费开放,主题为 "AI 人人免费可用"。


文心助手任务引擎 2.0 重磅上线:完成从 "帮你理解" 到 "帮你做到" 的关键跨越。可根据用户目标自主规划与思考执行,端到端完成 "信息收集、加工处理、创作表达、成品交付" 全流程闭环,全程无需人工干预。覆盖 30 多个行业、400 多项专业技能,包括专业级分析报告、办公全流程 PPT、量化交易终端、定时任务等场景,并支持定时触发、条件触发后的主动执行。数据显示,文心助手日活用户同比增长 83%。该功能在行业内同类产品多采用订阅或积分收费的背景下完全免费开放。


百度搜索推出全球首创 "整页可交互"GUI 搜索结果形态:不再只有图文,而是生成可以互动的知识卡片、步骤图解、可交互动画等组件,实现完全可互动。搜索框还是那个搜索框,但底层能力已被 AI 重构。


文心老师教育产品升级:可以像真人老师一样,为用户提供动态板书、分层讲解等方式的题目教学。


8月19日,2026 世界机器人大会期间,百度智能云举办具身智能专题论坛,并与贝塔无限、中亿具身、拓元智慧、超脑未来四家企业集中签署战略合作协议。


双方将围绕万卡级异构算力底座、具身智能数据体系、世界动作模型训练、全周期云安全及场景商业化展开深度合作,共建群体智能 AI Infra,启动万卡规模群体智能基础大模型训练计划,打造仿真与合成数据生成管线,推动具身智能技术在工业、物流、交通等领域的产业化落地。


8月18日,百度发布 2026 年第二季度财报。总营收 313 亿元,其中 AI 业务收入占比达 50%,连续两个季度过半。李彦宏表示,这印证了百度从互联网公司向 AI 为先公司转型的决心,同时表态目标让文心大模型回到第一梯队。


核心 AI 数据:百度核心 AI 新业务收入 125 亿元,同比增长 25%;AI 云基础设施收入 73 亿元,同比增长 50%,其中 GPU 云收入同比暴增 283%,较上季度 184% 的增速进一步加速,连续四个季度三位数增长;AI 应用收入 25 亿元,同比增长 3%;AI 原生营销服务收入 26 亿元;资本开支 114 亿元,同比增长近 200%,占总营收比重达 45.2%,主要用于 GPU 采购和智算中心建设;百度文库与百度网盘 AI DAU 渗透率同比增长 27.4%。


财报同时披露百度已推出 DuMate 企业版。


8月14日,在百度AI Day开放日上,百度文库网盘通用智能体GenFlow正式官宣中文名「库库AI」,并上线「库库AI」办公独立端,「库库AI」独立端,包括库库AI办公PC客户端、库库AI网页端、小程序及库库AI企业版等。数据显示,库库AI AI办公MAU已超过2500万,位居通用AI办公赛道行业第一。


据悉,库库AI于2025年4月上线1.0版本,一年迭代至4.0版本,可并行调用PPT、Excel、Word等Agent完成一站式跨模态内容生成与编辑。此次推出的办公模式首期面向金融场景专项优化,内置全球上市公司资料、财报、研报等金融数据,支持全天候自动化任务执行与端云任务接力。库库AI企业版同时上线,产品打通公域专业内容、企业私域知识与行业专有资源三类数据,已在金融等高知识密度行业落地。


8月4日,据《科创板日报》记者获悉,百度已启动内部办公智能体dodo与百度搭子的团队整合,dodo相关研发人员、资源都将并入百度搭子,实现内外部办公智能体产品完全统一。对百度而言,办公Agent业务将从多线推进改为集中作战,也标志着百度全面入局AI办公赛道争夺。



MiniMax


8月31日,今日午后,MINI-MAX-W(00100)涨幅继续扩大,一度涨超19%,截至发稿涨17%,报353.8港元,成交60亿港元。华泰证券发布研报称,预期未来4-6月AI模型商业化加速,同时公司所处细分领域竞争格局呈好转趋势。下半年公司产品上线加速,有望推动收入较快增长:M3pro有望于9-10月推出,参数规模或达3万亿级别。


8月26日,MiniMax发布了2026年半年度业绩报告。上半年MiniMax总收入约为1.2亿美元(约合人民币8.1亿元),同比增长283.1%,增幅近3倍。与此同时,MiniMax报告期内的净亏损为3.58亿美元(约合人民币24.1亿元),同比收窄11%。


2025年MiniMax总收入是7900万美元,今年上半年的收入是2025年全年收入的1.5倍。在业绩交流会上,MiniMax创始人、CEO闫俊杰还提到,公司8月年度经常性收入(ARR)已超过8亿美元(约合人民币53.8亿元)。


8月20日,MiniMax发布多模态创作Agent工作台MiniMax Design,进一步释放原生多模态视频模型H3的生产力,推动模型能力进入商业内容生产流程。


MiniMax Design是一款把多模态模型能力变成真实可用的生产力的 Harness。用户提出创作需求后,它能够理解目标、拆解任务、调用相应的模型与Skills,完成从素材处理、生成和编辑到最终交付的完整过程。


8月13日,MiniMax 正式推出新一代音乐生成模型MiniMax Music 3.0,定位开放权重、生产级全能音乐模型。仅需创意描述和可选歌词,模型即可单次完成作曲、编曲、演唱与后期制作全流程,生成完整歌曲。模型权重同步开源,可通过 Hugging Face、ModelScope 等平台获取。


8月6日,近日,MiniMax关联公司上海稀宇极智科技有限公司发生工商变更,注册资本由40亿元增至55亿元,增资15亿元。此前5月,该公司注册资本由10亿元增至40亿元,增资30亿元。公开信息显示,该公司成立于2021年,经营范围包含:计算机系统服务;信息系统集成服务;信息系统运行维护服务;人工智能基础软件开发;人工智能应用软件开发等。


8月3日,MiniMax宣布正式开源新一代通用视频模型H3。该模型是一个全模态生成系统,能够统一理解文本、图像、视频和音频组成的多模态上下文,可生成最高2K分辨率、最长15秒、带原生立体声音频的视频,支持21:9、16:9、4:3、1:1等多种宽高比及11种语言。H3采用H3-Base与H3-Regenerate-2K两级生成架构,并提供H3-Context-IR处理系统,其中H3-Base已支持通过SGLang、vLLM、diffusers和ComfyUI等推理框架和工作流进行部署。完整的接口配置、请求参数、示例代码与参考结果,开发者可前往 Hugging Face Model Card 查看。



月之暗面


8月26日,根据外媒报道,据三位知情人士透露,月之暗面(Moonshot AI)正与微软、亚马逊以及 Alphabet 旗下的谷歌洽谈收入分成协议,旨在让这些美国云巨头托管其备受瞩目的 Kimi K3 模型。


任何达成的协议都可能标志着中国人工智能公司与美国主要云公司之间首个重大的收入分成契约。据其中一位知情人士透露,月之暗面与美国云服务商谈判中尚未解决的问题包括收入分成方式、数据访问权限以及 Token 使用情况审计。


知情人士称,目前讨论尚处于早期阶段,不能确定最终能否达成协议。Moonshot 未就潜在交易的评论请求作出回应。微软、谷歌和 AWS 拒绝置评。


8月24日,月之暗面 Kimi 官方微博宣布,第一代万亿参数多模态模型 Kimi K2.5 将于 8 月底(8月31日)正式结束服役。K2.5 于2026年1月发布并开源,是月之暗面首个支持视觉(图像和视频)和 Agent Swarm 的万亿参数模型,生命周期仅约7个月。Kimi K3已全面接棒,成为月之暗面当前主力旗舰模型。K2.5 的快速退役反映出国产大模型迭代周期已缩短至半年级别,行业进入 "月月有新版本" 的高速更替期。


月之暗面于8月16日启动G轮(Pre-IPO)融资,投前估值达到500亿美元,较 2025年底C轮43亿美元的估值在8个月内上涨超过 11 倍。同日,公司发布的 2.8 万亿参数开源大模型Kimi K3一举登顶全球开源模型,并成为 GitHub Copilot 内置可选项。


8月17日,月之暗面官方通知,因用户请求激增、算力逼近极限,被迫暂停 Kimi.com的C端新用户订阅,企业用户优先。官方同时宣布kimi-k2.5与 moonshot-v1系列模型将于2026年8月31日下线,建议开发者迁移至kimi-k3、k2.6或k2.7-code。此举也意味着国产大模型已进入"快速换代期"。


同日,中软国际与月之暗面签署"登月计划"Token 分成合作协议,双方围绕企业服务领域 Agentic AI 开展深度合作,中软国际依托能源电力、金融等央企客户基础,助 Kimi 进入高壁垒政企市场。


8月4日,月之暗面向 Kimi API 开发者发出通知:kimi-k2.5 模型的 API 将于 2026 年 8 月 31 日下线,同期下线的还有更早期的 moonshot-v1 系列模型,要求开发者迁移至 kimi-k3、k2.6 或 k2.7-code。此举标志着国产大模型进入快速迭代更替周期。


同日,路透旗下 IFR 报道称月之暗面计划最快本月内向香港联交所提交上市申请,集资额或达30亿美元。月之暗面回应称 "消息不实"。此前公司刚完成超35亿美元 F 轮融资,投后估值350亿美元,因认购金额超出原定目标三倍以上而提前关闭。



云知声


8月28日,云知声(09678.HK)发布截至 2026 年6月30日的中期业绩:上半年实现营业收入5.62亿元,同比增长38.7%;毛利1.86亿元,同比增长42.0%;净亏损率同比收窄超31个百分点。


其中 Token 业务收入同比增长约760%,业务毛利率超过60%,二季度环比增长超 500%,成为核心增长引擎;企业智能化服务收入4.78亿元,同比增长35.7%;端侧 AI 业务收入5380万元,芯片海外出货量同比提升50%。公司战略聚焦企业智能化服务、Token业务、端侧AI三大板块,正从传统AI项目交付商向 AI 平台型公司转型。


8月13日,云知声智能科技股份有限公司发布公告,继U2-Med三医大模型发布后,公司近日正式发布自研医学影像多模态大模型“U2-RadiMed”。


该模型支持单张、多张影像与文本的多模态混合输入,可完成“看影像→调知识→做推理→出结论”的完整工作闭环,为临床医生提供从病灶筛查、精准诊断到个体化治疗决策的全方位AI辅助支撑,助力影像诊断迈向更高阶的智能化。



科大讯飞


9月7日,科大讯飞正式发布星火X2.5大模型。该模型采用MoE架构,参数规模为293B-A30B,重点提升代码和智能体能力,并持续增强数学、理解等通用能力。模型基于全国产算力完成全流程训练及推理,持续优化国产超长序列训推难题,目前已上线讯飞开放平台。此前,星火X2.5-4B和1.7B两款端侧模型已开源,支持最长100万Token上下文,可本地部署于长文档处理、代码辅助、数据分析等场景。



商汤


8月26日,商汤发布2026年上半年业绩报告:


总营收29.1亿元,同比增长23.4%;毛利率 41.4%,同比提升2.9个百分点;


IFRS 口径净利润6.17亿元,为上市以来首次半年度盈利;经调整净亏损3.86亿元,同比收窄67.3%;


生成式 AI 收入23.3亿元,占总收入79.9%,同比增长28.2%;海外业务收入同比增长127%;


形成 “一套模型 + 一座 Token 工厂 + 一套智能体管控系统” 的商业体系,公司预计2026年全年经调整 EBITDA 有望实现盈利。


8月25日,商汤旗下AI办公智能体 “小浣熊家族” 正式升级为商汤小浣熊 Raccoon Work,累计服务用户突破2000万,周活跃用户超300万,日活用户近期实现10倍量级增长。产品覆盖会议纪要生成、跨部门任务协同、文档处理等办公全场景,已服务联想、平安科技、三大电信运营商,并完成国产操作系统适配与企业私有化部署验证。


8月21日,商汤正式发布并开源SenseNova U1.5 Lite正式版,模型采用 8B MoE 架构,单张消费级显卡即可流畅运行。


相较预览版,正式版围绕真实视觉创作场景重构训练体系:原生支持3-4k字符超长指令输入,强化视觉生成质量、复杂指令遵循、中英文文字排版、原生4K直出、局部图像编辑与精细视觉控制能力,提升多轮迭代创作的稳定性与可控性,推动AI视觉生成从 “单次生成” 迈向 “生产级持续交付”。模型已在 GitHub、Hugging Face、魔搭社区同步开源。


8月11日,商汤 “日日新” 大模型体系上线多模态智能体模型SenseNova 6.8 Flash Lite Preview,具备自主任务规划、持续执行、多 Agent 协作与动态纠偏能力,定位轻量级 “委派智能” 基座,面向低延迟、高并发的智能体落地场景优化。


8月3日,商汤现面向社区开源轻量级统一多模态模型的预览版本SenseNova U1.5-Lite-Preview。SenseNova U1.5-Lite-Preview并非简单的模型规模升级,而是基于U1的一次系统性迭代,不仅在同一架构中贯通视觉理解、推理、生成与编辑,还仅以 8B-MoT 的轻量大小,将能力推进到4K、更精细的真实质感、更复杂的视觉控制和可持续迭代编辑。



DeepSeek


8月31日,DeepSeek V4 系列首个多模态模型 DeepSeek-V4-Flash-Vision-Exp 在 Hugging Face 上线,采用 MIT License 开源。公开内容包括模型文件、Tokenizer、Prompt Encoding 参考实现,以及覆盖视觉编码器、Aligner、DFlash Attention、MoE 等核心模块的最小化 PyTorch 推理实现。这是 DeepSeek V4 系列首款原生支持图片输入的视觉模型,官方标注为“Exp”实验版本,于 8 月 21 日上线 DeepSeek API 平台。模型除文本外可接收图片输入,能够描述画面、识别截图中的文字、分析图表,支持 JPEG、PNG、GIF、WebP 等格式。在 Agent、推理、世界知识等纯文本任务上与 V4-Flash 正式版持平,在需要视觉理解的 Agent 基准测试中较 V4-Flash 大幅提升,多模态 Agent 能力已接近 Opus-4.8。


8月21日,DeepSeek V4 系列首款原生多模态模型DeepSeek-V4-Flash-Vision-Exp上线 API 平台,官方标注为实验版本。该模型在 V4-Flash 架构基础上融入视觉理解能力,支持 JPEG、PNG、GIF、WebP 等格式图片输入,可完成图片描述、文字识别、图表分析等任务,纯文本能力与 V4-Flash 正式版持平,视觉相关 Agent 基准测试表现大幅提升。


8月20日,DeepSeek Harness迎来公测后的首次重要更新。DeepSeek Harnessv0.1.0-rc.8版本上线,多模态能力成为这次更新的重头戏。此次更新共带来14项调整,覆盖多模态输入、子代理协作、终端体验、工具调用和开发者支持等多个方向,既补齐了Agent处理图片等多模态任务的能力,也进一步完善了子代理协作、终端交互和工具调用体验。


8月17日,深度求索官方宣布对DeepSeek API价格进行更新调整,采用峰谷定价,空闲时段价格为高峰时段价格的一半。高峰时段为北京时间9:00-12:00、14:00-18:00(其余为空闲时段)。新价格于北京时间8月17日00:00开始生效。


最新调整后的价格方案为,高峰时间段,V4 Pro每百万tokens输入(缓存未命中)9元(涨幅200%)、输出27元(涨幅350%),缓存命中输入0.3元(涨幅1100%)。空闲时间段,V4 Pro每百万tokens输入(缓存未命中)4.5元、输出13.5元,缓存命中输入低至0.15元。以此看来,V4 Pro高峰时间段涨幅最高达1100%,DeepSeek-V4-Flash同步上调。


8月13日,DeepSeek V4 Pro 正式版已经更新至API,调用模型名不变。新版本大幅增强了Agent能力,支持Responses API和Codex接入。API文档显示,V4 Pro正式版定价为3元/百万Token输入、6元/百万Token输出,缓存命中输入为0.025元/百万Token。DeepSeek V4 Pro正式版基准测试显示,其在终端Agent测试Terminal Bench的得分为87.9分,逼近Fable 5的88.0分。在AI安全智能体评测基准CyberGym、以及在高难度的智能体评测基准AutomationBench上,表现甚至反超Fable 5。


同日,DeepSeek Harness的开发者预览版(v0.1版本)面向全球Harness开发者开放测试,并同步以MIT协议开放源代码。DeepSeek Harness采取“一切皆插件”的设计思路,模型、工具、技能、会话、沙箱、存储、循环、调度、UI等所有Agent能力均由插件组合而成,可自由替换、灵活重组。


8月5日,据《财经》报道,多名交易人士透露,大模型公司DeepSeek已重启第二轮融资,本轮计划募资500亿元,投前估值约5000亿元,并计划于8月下旬完成签约。今年4月,DeepSeek开启首轮融资并于6月完成交割,融资金额500亿元,估值超3500亿元,成为中国AI大模型史上首轮融资规模最大的公司。第二轮融资曾于7月中旬开启,但在7月底突然暂停。据媒体7月26日报道,暂停原因之一与DeepSeek创始人梁文锋对网上流传的“面向投资者的会议实录”感到不满有关。



智谱


8月31日,智谱发布 2026 财年上半年财报:营业总收入 9.54 亿元,同比增长 399.7%;归母净亏损 20.71 亿元,同比收窄 12.1%。


在同期业绩说明会上,公司正式披露下一代大模型研发进展:明确采用大基座技术路线,暂不公开具体参数,后续将推进中训练与后训练工作,研发聚焦释放基座能力与落地效率,已开展推理侧预研,目标实现模型发布首日即支持满规模业务调用。 


8月27日,火爆全网的神秘“牛来模型”被智谱官方认领,是其全新开源的原生多模态模型GLM-5.3-Flash (320B-A18B),支持图片、视频、文件和文本多模态输入。


此前,智谱为收集真实用户反馈,将这款模型以Ox Alpha的名称在OpenCode和OpenRouter上进行了测试,上线首日就登顶了OpenRouter调用量榜单,并刷新了单日tokens用量历史纪录,被称为“牛模王”。


8月19日,智谱宣布 GLM-5.3 API 即日起正式上线,已接入 ZCode 等编码平台,并纳入 GLM Coding Plan 订阅体系,定价与 GLM-5.2 保持不变。


8月14日,智谱AI正式发布新一代开源模型GLM-5.3。同日,范式旗下统一模型调用平台PhanRouter完成适配并开放调用,成为首批支持该模型的平台之一。用户登录PhanRouter后,仅需将模型名称切换为GLM-5.3,无需更换API地址或重新注册,即可直接调用。


GLM-5.3总参数7430亿,能力全部源自后训练强化学习,编程能力位列开源模型第一,网络安全能力追平海外前沿闭源模型,长程软件工程与Agent任务表现突出。


PhanRouter依托统一API、智能路由与缓存优化,提供低于官方的调用价格与99.9% SLA保障,兼容多款国产芯片,适配超22万个模型。行业认为这种“发布即上线”模式可降低企业用模门槛,加速AI能力落地。



昆仑万维


8月28日,昆仑万维(46.740, 1.31, 2.88%)(维权)旗下AI视频创作平台SkyProduction宣布接入阿里最新视频生成模型Wan 3.0。8月28日至30日,Wan 3.0将在SkyProduction面向所有用户限时免费使用,8月31日起恢复收费,最低价格为0.05元/秒,生成一条30秒视频最低约1.5元。


8月21日,昆仑万维旗下 AI 短剧生产工具 SkyProduction(天工短剧工作台)完成 Seedance 2.5 版本迭代升级,并将720P规格 Seedance 2.5 视频生成定价下调至0.4元/秒,480P 规格0.3元/秒,通过成本下探降低精品 AI 短剧创作门槛。算下来一分钟视频生成成本仅24元。


昆仑万维介绍,当前 AI 短剧创作存在单次生成成本偏高、反复重拍推高预算等痛点,此次降价旨在让更多创作者能够负担 AI 短剧制作。平台同时上线剧本本地化翻译、片段重拍和最长10分钟视频生成等功能,并推出130% 分账加500万奖励的创作者激励计划。天工短剧工作台已服务超100万注册用户,依托海外短剧分发渠道 DramaWave 覆盖从剧本生成、视频制作到海外发行的完整链条。


8月20日,昆仑万维举办 2026 年半年度业绩说明会,董事长兼 CEO 方汉回顾公司上半年整体情况,详细披露 AGI 与 AIGC 核心战略的落地进展。


方汉强调,公司持续围绕 AGI 与 AIGC 核心战略,推进技术研发、产品迭代与全球商业化落地,主营业务保持强劲增长态势。公司形成以 SOTA 大模型为技术底座、以全球化应用为牵引的 AI 业务体系,四大人工智能模型(SkyReels 视频、Mureka 音乐、Matrix 世界模型、Skywork 文本与多模态)持续迭代,其中 SkyReels 和 Mureka 在第三方评测中位居全球前列。


在 AI 短剧工业化方面,公司依托 Agent 技术整合全球顶级视频模型,构建 "剧本直达成片" 一站式生产体系。AI 音乐方面,Mureka 保持高频迭代,平台升级简易模式,打通从 "创意构思" 到 "歌词 — 人声 — 角色 — 歌曲 —MV" 的完整创作链路。


方汉此前在公开场合正式宣布 2026 年为 "世界模型元年",给出的产业预判是:AI 的核心命题正从 "生成" 转向 "理解与交互",世界模型将成为具身智能的 "无限数据引擎"。


8月18日,昆仑万维正式发布新一代AI音乐生成模型 Mureka V9.5,试图在一个更真实的音乐框架下,让编配、人声、情绪与创作意图回归“克制与自然”。其跳出行业“编配堆叠”的内卷方向,主打克制自然的创作风格,旨在打造出值得“单曲循环”的真正作品。


Mureka V9.5基于MusiCoT音乐思维链框架,将“真实音乐的生成法则”深度刻入了思维链,人声表现良品率达61.0%,高达97.0%的控制良品率与95.7%的曲风完全体现比例,证明模型的强大算力被用来精准执行Prompt,而非用繁复的轰炸来掩盖音乐逻辑的缺失。其中中文国风赛道提升尤为显著,优化了咬字精度、人声气口与和声编排,进一步贴近真人演唱质感。


本次升级基于2.5万份海内外用户反馈迭代打磨,目前模型已在国内外平台同步开放体验。


8月7日,昆仑万维旗下天工短剧工作台**SkyProduction**正式接入字节跳动 Seedance 2.5 视频生成模型,同步推出阶梯定价:720P分辨率低至0.4元/秒,480P分辨率低至0.3元/秒,720P价格仅为官方参考价的约30%,处于行业同类平台超低区间,进一步降低 AI 短剧工业化生产成本。



360


8月29日,360 在鸿蒙生态大会 2026 安全论坛上,发布多项鸿蒙应用安全检测成果:新一代终端安全智能体完成鸿蒙生态全面适配,围绕鸿蒙微内核、分布式软总线深度优化,落地40余项核心安全能力;自研漏洞挖掘智能体 “图龙锋” 同步启动鸿蒙生态适配探索,构建端到云全覆盖的鸿蒙 PC 安全防护体系。


8月17日,360集团创始人周鸿祎发布公司全员信,题为《以领导力驱动业务创新与组织变革》,宣布360全面转型为AI Native(AI 原生)组织,这是 "All in Agent" 战略的进一步升级。


核心内容:周鸿祎明确提出,在公司向AI Native组织转型过程中,各级管理者是培养超级个体、打造超级团队的第一责任人;此次转型 "不是一次普通的干部领导力升级",而是360"用AI重新创业";管理者年度绩效考核与三项 AI 成果直接挂钩,不学习AI、不推动AI落地的高管将被 "淘汰";要求管理者成为 AI 原生 "超级个体" 与教练,推动全员AI能力提升。


这封全员信标志着360从产品层面的AI布局升级到组织层面的全面AI化,是国内互联网安全企业中较早明确提出AI Native组织转型的公司之一。


8月12日,360 漏洞研究院发布消息,其自主研发的 AI 安全攻防系统 "图龙锋" 在 OpenAI 推出的编程智能体 Codex 中发现 6 个高价值安全漏洞,其中包括可导致远程任意代码执行的高风险缺陷。攻击者可利用相关缺陷绕过 Codex 的安全信任提示机制,用户仅打开从互联网下载的恶意项目文件即可触发攻击。相关漏洞已上报国家相关监管单位。


这是 360 图龙锋继此前发现 Claude Code、Flowise、Hermes、MCP 生态工具等主流商用及开源 AI 产品漏洞后的又一重大发现。图龙锋作为 AI 漏洞挖掘智能体,能够自动化识别 AI 产品和智能体框架中的安全缺陷,被业界视为 AI 安全领域的核心能力。


8月7日,360 智语全新升级企业级智能体评测体系,响应政企对智能体 “稳定、合规、可控” 的核心需求,将评测重点从 “能否搭建运行” 转向 “能否生产级落地”,覆盖能力、安全、合规、性能等多维度评估维度。



快手


8月31日,快手港交所公告显示,旗下可灵 AI 独立运营主体北京可灵完成新一轮增资扩股,国家人工智能产业投资基金正式入局,注入现金资本 14 亿元,持股约 1.14%;正大机器人同步注资约 1.31 亿元。 至此可灵 AI 本轮总额上限 204.47 亿元(约 30 亿美元)的融资全部落地,投后估值约 1228 亿元人民币(约 180 亿美元),股东阵容汇集腾讯、阿里、百度三大互联网巨头与国家级产业基金。快手仍持有可灵 AI 约 68.33% 股权,保持绝对控股。


8月29日,快手举行 2026 年 Q2 业绩电话会议,管理层明确表态 AI 是快手现阶段最高优先级的长期战略。核心要点包括:可灵 AI 商业化落地取得重大突破,单季营收突破 8.5 亿元,同比增速超 200%;全球累计用户突破 1 亿,覆盖 224 个国家和地区;最新版本可灵 3.0-Turbo 上线,原生 4K 生成能力已经达到商用交付标准,不少国际知名广告公司、影视工作室已经成为付费企业客户;可灵完成独立外部融资后,算力、数据中心及人才投入将进一步加大。


管理层未给出三季度及下半年业绩指引,但强调 AI 长期投入决心不变。同日,AI 互动内容创作者招募持续推进,快手明确将 AI 互动内容作为下一代内容形态的核心布局。


8月19日,快手最新财报显示,2026年第二季度,可灵AI营业收入超过8.5亿元,同比增长超过200%。本季度,可灵AI围绕专业创作、高频生产和自动化工作流持续完善产品能力。报告期内,可灵AI 3.0系列模型推出原生4K视频直出功能;可灵MCP与CLI上线,支持AI Agent调度可灵AI进行批量创作。



智象未来


8月19日至23日,2026 世界机器人大会(WRC 2026)在北京举办期间,智象未来创始人兼 CEO 梅涛发表《原生全模态世界模型:从 “模拟世界” 到 “交互世界”》主题演讲,系统分享公司对 Physical AI 与具身智能发展路径的判断。


梅涛提出,大语言模型、多模态模型、具身智能三条技术路线正加速融合,2026 年是 “世界模型元年”;但 “高 IQ 不代表全能”,模型在测试中表现优异不等于能在真实物理环境中长期稳定完成任务,真正的世界模型需要具备世界状态表达、物理规律推演、持续真实交互三大核心能力。他同时指出,世界模型是具身智能的 “认知中枢”,可构建 “数据 — 认知 — 行动 — 反馈” 的闭环飞轮,目前公司已与诺亦腾机器人合作,通过原生全模态模型增强人体动作数据,扩大机器人训练数据规模、降低采集成本。


8月17日,智象未来(HiDream.ai)正式发布原生全模态交互式世界模型 HiDream-O1-World。该模型搭载的是智象自研的原生全模态(UiT)架构。作为核心基座,UiT此次迎来升级,在交互式世界模型领域公认的核心技术挑战——时空一致性与物理一致性上,取得了关键性突破。在美团 LongCat 团队与复旦大学联合推出的交互式世界模型评测基准 WBench 中,HiDream-O1-World 在核心的Navi分榜中,以平均分80.9的成绩登顶榜首,其中在物理维度以73.3分位列第一,Consistency维度达88.0分。两项关键指标均位居前列,成为该榜单中综合表现排名第一的模型。该模型具备漫游、编辑、交互三大功能,支持文本、图像、交互等多模态方式输入。用户可一键生成时空一致、符合物理规律、可长时推演的完整世界。



AI大模型工场已经组织了非常精准的「AI科技类垂直社群」,覆盖超1000位AI圈大佬,阿AI业务负责人,字节AI业务负责人,腾讯AI业务负责人,华为AI业务负责人,百度AI业务负责人、科大讯飞AI业务负责人,360AI业务负责人、智谱技术负责人,月之暗面技术负责人等,都在群里啦,欢迎AI业务负责人加入。请加微信XXZ21000,注明真实身份。

图片

数据支持天眼查,大模型独家合作账号

— END —

监制 / 刘老师
编辑 / AIGCCCCC
视觉 / 大模型
微博 / @AI大模型工场
TG/AI  Marketing Field

 图片


大模型应用创业者,你怎么看

■ 百度文心一言,阿里通义千问   ▍通用大模型案例
 ■ 科大讯飞星火 京东  ▍产业大模型案例

■ 商汤日日新、腾讯,昆仑万维   ▍ 金融大模型案例

■ 盘古大模型,中国电信,医联 ▍医疗大模型案例

■阅文大模型,腾讯音乐大模型 ▍ 文娱大模型案例

■知乎,360大模型,火山引擎 ▍ 教育大模型案例

■  网易,金山办公大模型   ▍    更多行业大模型案例



上次介绍腾讯混元Hy3上线即爆,WorkBuddy紧急扩容,实测三个真实任务后我服了


图片


图片


本文由大模型领域垂直媒体「AI大模型工场」

原创出品,未经许可,请勿转载。

/

欢迎提供新的大模型商业化落地思

【声明】内容源于网络
0
0
AI大模型工场
关注AI产品、算力、具身智能机器人、AI硬件。 在AI大模型工场,看懂下一个硬核时代。 商务合作🤝+ V: XXZ21000
内容 418
粉丝 0
AI大模型工场 关注AI产品、算力、具身智能机器人、AI硬件。 在AI大模型工场,看懂下一个硬核时代。 商务合作🤝+ V: XXZ21000
总阅读1.9k
粉丝0
内容418