大数跨境

对话PPIO姚欣:Token工厂的第一客户不再是人,而是Agent

对话PPIO姚欣:Token工厂的第一客户不再是人,而是Agent 智东西
2026-07-19
9
导读:万亿Token调用量验证智能Token工厂。

万亿 Token 调用量验证智能 Token 工厂。
作者 |  王涵
编辑 |  漠影
2026 年初,开源 AI 智能体 OpenClaw 凭借自主规划与多步推理能力引发行业震动,标志着"AI 自主执行”时代的到来。随之而来的是个人智能体的爆发式增长,全球 AI 智能体市场规模预计将从 2024 年的 51 亿美元跃升至 2030 年的 471 亿美元。
Agent 的每一次长程任务都依赖海量 Token 供给。在智东西与 PPIO 联合创始人兼 CEO 姚欣的深度对话中,他指出行业正经历从“人用 Token"到"Agent 用 Token"的范式转移。云服务商亟需构建面向 Agent 工作负载的“智能 Token 工厂”,以提供更低延迟、更高吞吐的运行环境。
在此背景下,PPIO 于 WAIC 2026 大会正式发布 Agentic Cloud 战略定位及智能模型网关新品,旨在打造面向 Agent 时代的智能 Token 工厂。该体系由智能模型网关与 Agent Harness 层两大原生产品构成。

智能 Token 工厂:让 Agent 既省钱又变聪明

尽管推理成本逐年下降,但 Agent 任务复杂度的攀升导致单次任务 Token 消耗量激增至数万甚至数十万,综合成本压力不降反升。此外,单一模型难以兼顾深度推理、快速响应及多模态处理等多样化需求,且现有 MaaS 平台生态封闭,难以满足 Agent 对高稳定性和低延迟的严苛要求。
针对上述痛点,PPIO 推出智能模型网关,核心逻辑在于“提升智能上限的同时大幅降低成本”。

混合模型机制与智能调度

网关引入“混合模型”(MoM)机制。在处理高风险或关键步骤时,系统触发多模型融合,通过交叉验证生成最终答案,有效避免单模型“偏科”导致的任务失败。
同时,网关实施智能调度与成本优化策略:简单任务路由至轻量模型,复杂推理调用强模型,并辅以上下文压缩、结果复用及预算护栏机制。实测数据显示,PPIO 通过融合多款主流模型进行混合推理,性能可接近顶级模型水平,智能度提升 20%,成本降低 50%-60%。
姚欣表示:“我们不卖最贵或最便宜的模型,而是将模型智商稳定在头部梯队,价格降至中低梯队。”配合自研推理加速引擎及 Prompt Cache 技术,Token 成本最高可省 80%。目前,PPIO 已入选中国信通院首批“企业级 Token 服务性能攀登基线”,实现 TPS≥55 个/秒、TTFT≤0.9 秒、调用成功率≥99.9% 的硬指标。

Agent 沙箱爆发:Harness 为智能体装上手脚与记忆

传统云服务围绕人类操作构建,而 Agent 具有毫秒级启动、短生命周期及高频并发的特征。行业共识认为,Agentic AI Infra 的核心已从 GPU 转向 Runtime(运行时),即需要低延迟、隔离安全且自带工具接口的专属环境。
PPIO Agent 沙箱基于 microVM 技术,实现毫秒级冷启动(<200ms)与系统级安全隔离。其 Auto Pause/Resume 机制可在任务空闲时自动暂停,恢复时秒级唤醒,成本较同类产品降低 90% 以上。作为国内首款兼容 E2B 接口的沙箱,该产品上线不到一年业务规模增长超 123 倍。
为解决生产级 Agent 的编排与操作难题,PPIO 持续演进 Harness 能力:内置 Browser Use 驱动浏览器操作,Computer Use 实现 GUI 自动化,Code Interpreter 执行代码分析,并通过 MCP Server 协议接入飞书、数据库等外部服务。这套组合拳覆盖了从信息获取到执行操作的完整链路。
基于 Harness 层,平台预置 PPClaw、PPHermes 等开箱即用模板,支持一键部署与 7×24 小时托管。同时,PPIO 提供面向 Agent 的 AI 原生接口,兼容 LangChain、CrewAI 等主流框架,开发者无需修改代码即可接入全量基础设施能力。姚欣预言,未来企业搭建数字员工团队的模式或将替代传统 SaaS。

从基础设施到 Agentic Cloud 的进化

PPIO 日均万亿级 Token 消耗量的背后,是其历时八年布局的分布式算力网络。从分布式云底座到推理加速平台 PPInfer,再到集成全栈能力的 Token 工厂,PPIO 完成了从基础设施到 Agentic Cloud 的进化。
数据印证了这一战略的成功:2026 年 6 月,PPIO 日均 Token 调用量超 1.2 万亿,位居中国独立 AI 云计算服务商榜首,同比增长超 8 倍;AI 云收入自 2025 年起增长逾十倍,营收达 7.703 亿元,全球注册开发者超 67 万名。
尤为亮眼的是,PPIO 平均 GPU 利用率常年高于 75%,远超行业平均水平。这得益于其全球调度网络的“削峰填谷”能力:利用东西半球时差互补,将全球闲置算力动态分配至需求高点,确保资源高效利用,从而大幅降低单位 Token 成本。

结语:智能 Token 工厂奠定 Agent 时代基建

姚欣指出,智能上限不仅存在于模型内部,更可通过 Agent 工程与模型融合在外部大幅提升。当行业聚焦于模型参数竞争时,PPIO 选择深耕底层基建,致力于让 Token 更便宜、Agent 运行更稳定。
随着 Agent 从单任务执行向多智能体协同及人机协作演进,对 Token 供给能力的要求将持续升级。智能 Token 工厂不仅是适配当下需求的技术方案,更是为即将到来的智能体经济爆发提前布局的关键基础设施。

【声明】内容源于网络
0
0
智东西
各类跨境出海行业相关资讯
内容 11724
粉丝 0
智东西 各类跨境出海行业相关资讯
总阅读186.7k
粉丝0
内容11.7k