大数跨境

工作流可以自我进化了,英伟达开源 SoL-Pi,每小时省13.5刀!

工作流可以自我进化了,英伟达开源 SoL-Pi,每小时省13.5刀! AI科技评论
2026-09-11
4
导读:Token 砍半,活没少干,每小时还省13.5刀!
Token 消耗减半,效能显著提升,每小时节省成本高达 13.5 美元。

作者丨高允毅

编辑丨岑峰

利用 AI 优化 AI 工作流已成为降本增效的关键路径。英伟达最新开源了效率提升框架 SoL-Pi,该工具让 AI 充当“监工”,自动识别并修复 Agent 工作流中的冗余环节,实现自我迭代优化。
实测数据显示,SoL-Pi 可使 Token 消耗最高减少 64%,API 调用成本下降 50%–54%,在实际开发场景中,每小时可为企业节省 8.75 至 13.5 美元。
其核心优势源于严苛的筛选机制:英伟达让 AI 提出了 152 个优化构想,通过自动化流水线层层淘汰,最终仅保留 4 个最高效的机制作为 SoL-Pi 的核心骨架。该项目基于开源项目 Pi 改造而成。

01

AI 如何识别并消除低效行为?

AI 的低效问题主要体现在即时浪费与长期困境两个层面。在复杂的 Agent 协作场景中,随着任务周期拉长,上下文历史记录日益臃肿,工具调用频繁,导致大量冗余计算。此外,AI 缺乏人类变通能力,常将连续操作机械拆分为多次决策,累积造成巨大的资源浪费。
针对行业热议的 RSI(AI 自我优化)概念,盲目在线试错成本高昂且失败率超过 90%。英伟达采取了“离线筛选、在线应用”的策略:先让 AI 批量生成 152 个优化方案,在自动化沙盒中进行“自动研究循环”筛选,最终确立了三种管理模式的优劣:
一是计划经济模式,由主模型定死步骤,因过于僵化被弃用;二是中心化管理模式,由超级主管 AI 实时调度,虽灵活但导致主模型代码库臃肿不堪;三是共享快闪模式,系统仅维护最简模板,每个实验独立复制运行,结束后即丢弃临时代码。
最终,第三种“共享快闪模式”胜出,并从中提炼出四大核心机制:

▎机制 1:动作融合

传统流程中,AI 修改代码后需单独决策是否运行测试,增加了推理开销。优化后,系统将“改代码 + 跑测试”等固定连续动作合并,直接省去中间的决策环节。

▎机制 2:在线上下文压缩

针对 Transformer 架构上下文线性累加导致的成本激增问题,系统将大任务拆解为独立小任务。每完成一个小任务,即将历史记录压缩为精简版摘要,仅保留关键结论。仅在需要核对细节时,才调取原始记录。

▎机制 3:观察包

工具输出的长日志(如数百行测试结果)不再完整填入上下文。优化后,完整结果存于本地,上下文中仅保留“摘要 + 索引”。AI 按需调取具体段落,大幅节省空间。

▎机制 4:证据保存型简化器

在排查错误日志时,避免主模型全量阅读。系统利用低成本小模型将日志提炼为“诊断报告”,报告结论可回溯至原文具体位置。主模型仅需审阅精简报告,疑点处再核对原文。

02

性能实测:超越 Pi 框架,重塑大模型性价比

为验证效果,英伟达构建了 535 个可验证环境,包含 495 个基于 GitHub 真实 Bug 还原的任务,以及 40 个无剧本的开放式沙盒探索任务。
在原生框架驱动的 GPT-5.6 Sol、Claude Opus 5、开源智能体底座 Pi 以及 SoL-Pi 的同台竞赛中,SoL-Pi 展现了卓越的降本能力。
对比结果显示:相较于 Pi 框架,SoL-Pi 的 Token 消耗减少 45%–49%,开发成本降低约三分之一;相较于模型原生官方代理框架,Token 消耗最高骤降 64%,API 成本最多下降 54%。
英伟达由此提出“效率即 RSI"的观点,倡导"Efficiency for efficiency"理念:通过提升当前工作效率节省预算,反哺更多实验尝试,从而加速 AI 能力的泛化与进步。
这四大机制挖掘的是 AI 工作流中的普遍“通病”,具有极强的通用性。在当前阶段,广泛尝试比单一方向深挖更为重要。即便不直接使用 SoL-Pi,这些优化思维亦可应用于各类 AI 工作流中。
参考链接:https://nvlabs.github.io/SoL-Pi/
【声明】内容源于网络
0
0
AI科技评论
聚焦AI前沿研究,关注AI工程落地。
内容 8948
粉丝 0
AI科技评论 聚焦AI前沿研究,关注AI工程落地。
总阅读241.9k
粉丝0
内容8.9k