大数跨境

扣子空间,AI通用Agent,对标Manus?

扣子空间,AI通用Agent,对标Manus? Nolan聊
2025-04-19
1
导读:一力降十会
前两个月,爆发了一个AI通用Agent的小事件,manus。为此AI小圈子稍微拓展了下,大家以为会是例如deepseek的爆火,但显然并没有延续这把火。
可是通用型Ai agent走入了我的眼里。我对AI当下的发展眼光,基本都是来自陆奇的《我的大模型世界观》,有兴趣的可以去看下。总体来说,LLM大模型即便拆分多细,在当下热门的应用都像是对大模型的初步探索。
其中有个分支,就是做RPA(在我看来),manus就是类似这样的自动牛马,从提问到deepseek的逻辑推理,再用RAG联网找内容,最后根据自动化流程生成一个合适的内容。
简单来说:你不再需要一个个去提问,而是一次性得到完美的流程和答案。
所以,manus刚出来的时候,圈内小小的震撼了下。
今天,扣子带来了自己的扣子空间内测,想要做的事,也是类似manus的通用型Agent,被圈内的朋友眷顾,我有幸拿到内测激活码。
界面很典型的playground界面,左侧任务列表,中间聊天。我暂时想不到什么任务想做,但我知道这种工具,类似的方式是做数据分析,数据挖掘,或者说做行业研究分析,这种自动化的方式,简直无敌。
果不其然,下面的例子“股票研究”,你讲这个,股票韭菜可就不困了。
于是,我试了下,总体的思路,是根据任务内容,先推理,再输出一个长而准确的prompt,再让我确认任务开始。
执行过程,会思考,会推理,会检索文件,保存文件。
可能由于用的人太多,3-4分钟,就会出现一次报错,但影响不大,刷新页面就能完成,而且不会中断任务。
最后任务耗时13分钟,,就会出现一次报错,但影响不大,刷新页面就能完成,而且不会中断任务。
结果看起来,像模像样。实时追踪,就是实时预览结果,任务是prompt明细,终端一直报错(太多人用了),浏览器则是保留检索到的内容,文件则是一个页面的所有内容。
在官方的案例里,数据跟内容是用next.js写的貌似,页面好看很多,体验也更震撼不少,我猜测我的prompt可以调整输出的内容代码,但我没细去研究。
时间紧迫,看到好玩的就来分享下,完成了,现在我可以分享下我的邀请码了。

PNBPP6D0 

OR9RO7DC

QP95KNWW

IMQIO3MN

A5IGFMMH

总结:
要怎么说呢,通用Agent,作为一个研究性的方向去考虑,确实是可以做的。但是在Chatgpt发布了新模型下,效果的精确程度几乎让一众做图片AI的厂商瞬间感觉自己做了无用功。
在搏击里面,体重分阶是必须的,70公斤的对手就是70公斤,50公斤的对手就是50公斤,不能逾越一点。武功里面也有一句话,叫一力降十会。底子好了,什么妖魔鬼怪,都难以撼动。
大模型就是底子,底子一完善,就能完成绝大部分应用所无法做到的内容,其实图文修改是很好的场景,midjourney,stabledisfusion,这两家之前的教程,可以覆盖了当前大部分的ai图片,常用就是SD修改图片,定位模型,MJ来完成背景图的想象。
但是Gpt这个,如此简单,就能完成这么高精度的作品……
什么叫一力降十会,这个就叫做一力降十会。
至于扣子空间,后续能走到什么位置,很难说,目前大部分的ai厂商都在探索,生怕掉队,这确实值得焦虑的,因为来自AI的流量,已经越来越多了。

【声明】内容源于网络
0
0
Nolan聊
1234
内容 169
粉丝 0
Nolan聊 1234
总阅读15
粉丝0
内容169