大数跨境

OpenAI 绝密项目「草莓」首次曝光,AI将具有人类推理能力,内部人士曾警告:可能威胁全人类!

OpenAI 绝密项目「草莓」首次曝光,AI将具有人类推理能力,内部人士曾警告:可能威胁全人类! 星辰Career
2024-07-16
0
导读:OpenAI 绝密项目「草莓」首次曝光,AI将具有人类推理能力,内部人士曾警告:可能威胁全人类!


点击上方蓝色文字关注我们



最近,OpenAI 去年大热的神秘项目「Q*」再次有了新动态。

据知情人士透露,以及路透社审阅的内部文件,ChatGPT 的制造商 OpenAI 正在研究一种新颖的方法来开发其人工智能模型,该项目代号为“Strawberry”(草莓)。


OpenAI 内部团队正在开发 Strawberry,据路透社5月看到的最新内部文件副本显示。路透社无法确定该文件的具体日期,该文件详细描述了 OpenAI 如何利用 Strawberry 进行研究的计划。知情人士称该计划仍在进行中。路透社无法确定 Strawberry 距离公开发布还有多远。

即使在 OpenAI 内部,Strawberry 的工作方式也是高度保密的。





报道称,「草莓」模型的目标不仅在于让公司的人工智能更好地回答问题,还能够自主规划并可靠地浏览互联网,以实现 OpenAI 所称的「深度研究」。据采访的十多名人工智能研究人员称,这正是人工智能迄今未能解决的问题。

当路透社向 OpenAI 询问有关「草莓」的详细信息时,OpenAI 的发言人没有直接回应,而是模糊地表示:我们希望我们的人工智能模型能够像人类一样看待和理解世界。业界普遍在不断研究新的人工智能能力,我们相信这些系统的推理能力会随着时间的推移而不断提升。

值得注意的是,去年曾报道的 Q* 模型也与此相关。据媒体报道,OpenAI CEO Sam Altman 去年没有及时向董事会披露 Q* 的进展,这被认为是引发 OpenAI 内部纷争的重要原因。当时,OpenAI 内部人士还担心 Q* 的重大突破可能会对全人类构成威胁。

路透社报道称,Q* 实际上是「草莓」的前身。在去年的报道中,Q* 被视为一项重要的技术突破。两位消息人士透露,今年早些时候,OpenAI 展示了 Q*,其能够解决当前市场上其他模型无法应对的复杂科学和数学问题。




近日,彭博社也报道了 OpenAI 在本周二的一次内部全体会议上展示了一个研究项目的演示,声称该项目具有类似人类的新推理能力。OpenAI 发言人证实了此次会议的存在,但拒绝透露具体细节,因此路透社无法确定所展示的项目是否是「草莓」。

在这次会议上,OpenAI 还提出了一套支持「自定义」AI 进化等级的分类系统。该系统从能够与人类进行基本对话的人工智能(Level 1)开始,一直到能够独立完成组织任务的高级人工智能(Level 5)。具体等级如下:

  1. 第一级 (Level 1):聊天机器人,具有对话语言能力的 AI。
  2. 第二级 (Level 2):推理者,能解决人类级别问题的 AI。
  3. 第三级 (Level 3):代理,能采取行动的 AI 系统。
  4. 第四级 (Level 4):创新者,能辅助发明的 AI。
  5. 第五级 (Level 5):组织者,可以完成组织工作的 AI。

OpenAI 内部认为自己目前处于第一级,但即将迈入第二级「推理者」,即能够解决基本问题的系统,类似于拥有博士学位但没有工具的人类。接受路透社采访的研究人员表示,推理是人工智能实现人类或超人类水平智能的关键。

尽管大型语言模型已经可以比人类更快地概括长文本和撰写优雅的散文,但这些技术在应对常识性问题时仍存在困难。例如,识别逻辑谬误和玩井字游戏时,模型常常会出现「幻觉」。人工智能研究人员普遍认为,对于 AI 来说,推理是指形成一个能够提前规划、反映物理世界运作方式,并可靠地解决具有挑战性的多步骤问题的模型。

提高人工智能模型的推理能力被认为是解锁其全部潜力的关键,使其能够完成从重大科学发现到规划和构建新软件应用程序的各种任务。


OpenAI CEO Sam Altman 今年早些时候表示,在人工智能领域,「最重要的进步将围绕推理能力展开。」Google、Meta 和微软等其他公司也在尝试使用不同的技术来改进人工智能模型的推理能力,许多进行人工智能研究的学术实验室也是如此。然而,对于大型语言模型(LLM)是否能够将想法和长期规划纳入其预测方式,研究人员的看法存在分歧。

例如,图灵奖得主、Meta 首席科学家 Yann LeCun 就认为,大型语言模型不具备像人类一样的推理能力。知情人士表示,「草莓」项目是 OpenAI 克服这些挑战计划的关键组成部分。路透社看到的一份文件描述了「草莓」的目标,但未说明具体如何实现。

近几个月来,OpenAI 一直在私下向开发者和其他外部各方发出信号,称其即将发布具有更先进推理能力的技术。消息人士称,「草莓」在训练过程中使用了后训练(post-training)方法,即在对大量通用数据进行训练后,调整基础模型以特定方式优化其性能。

开发模型的后训练阶段涉及微调等方法,这是当今几乎所有语言模型都必经的一个过程。这些方法包括让人类根据模型的响应提供反馈,并为模型提供好答案和坏答案样例。


知情人士称,Strawberry 类似于斯坦福大学2022年开发的一种方法,称为“自学推理者”或“STaR”。STaR 使 AI 模型能够通过反复创建自己的训练数据“自我提升”至更高的智能水平,理论上可以用于使语言模型超越人类智能水平。其创建者之一、斯坦福大学教授 Noah Goodman 告诉路透社:“我认为这既令人兴奋又令人恐惧……如果事情继续朝这个方向发展,我们作为人类将有一些严重的问题需要思考。”Goodman 并未与 OpenAI 有关联,对 Strawberry 也不熟悉。

OpenAI 目标之一是让 Strawberry 执行长时程任务 (LHT),文件称,指需要模型提前规划并在一段较长时间内执行一系列动作的复杂任务,知情人士解释。

为了实现这一点,OpenAI 正在创建、训练和评估公司所谓的“深度研究”数据集中的模型。路透社无法确定该数据集的内容或“长时间”指多长时间。

报道称,OpenAI 希望其模型利用这些能力通过“CUA”(计算机使用代理)自主浏览网页并根据其发现采取行动。OpenAI 还计划测试其在软件和机器学习工程师工作中的能力。



END



春招季已然来临,这是学生们迈向职业发展的重要阶段。星辰求职公司作为一家专业的求职咨询公司,致力于帮助学生更迅速地把握理想的工作机会,更希望能够帮助你顺利踏入职场,并实现职业发展的突破。
为此,我们更专注于提供:

1.个性化求职指导:专业导师会根据你的情况,提供简历修改和面试建议,为你制定求职方案。
2.
职业规划辅导:职业规划师会帮你明确职业目标并制定计划,评估你的技能和兴趣,助你求职成功。
3.
求职资源和网络:我们提供独家求职资源和行业信息,与多家公司合作,提供实习和全职机会,还可以与优秀求职者交流。
4.
职业技能培训:课程助你提升求职技能,如简历撰写、面试技巧等,增强竞争力。
5.
持续支持和跟进:我们将与你进行长期合作,提供职业发展咨询和指导,持续关注你的发展并提供帮助。


在这个竞争激烈的求职市场上,加入星辰求职公司将为你的求职之路注入新的动力和信心。让我们一起努力,开启你成功的职业之旅!


感谢你的关注和支持!我们的订阅号将为你呈现有趣且具有启发性的内容:涵盖各个领域的精彩文章、独家资讯和实用技巧。如果喜欢我们的内容,记得给我们一个赞,是对我们团队的鼓励和肯定。你的点赞和评论将激励我们不断创作更多优质的文章和分享更多有益的知识。
让我们一起探索更多精彩内容,共同成长和学习。
如有任何问题或需求,请随时与我们联系,期待与你的互动!

微信号|StarsCareer10

联系人|Charlie老师

公司邮箱|StarsConsulting@hotmail.com

(邮箱标注来意)

【声明】内容源于网络
0
0
星辰Career
1234
内容 407
粉丝 0
星辰Career 1234
总阅读23
粉丝0
内容407