
所有你需要知道的关于 Anthropic最新的AI模型: Opus、Sonnet、Haiku

AI军备竞赛今年没有放缓的迹象,Anthropic 是最新一家推出 Claude 3 来更新其产品的重量级玩家。
简而言之,Claude 3 是 AI 独角兽 Anthropic 的新一代大型语言模型 (LLM),这意味着它现在为 Claude AI 聊天机器人提供动力。从技术上讲,Claude 3 系列中有三种不同的模型:高端的 Claude 3 Opus,中端的 Claude 3 Sonnet 和尚未发布的 Claude 3 Haiku。
该公司不仅声称 Claude 3 击败了其旧的 Claude 2.1 模型,而且还宣称它让 ChatGPT 的竞争对手 GPT-4 模型和谷歌的 Gemini Ultra 相形见绌。什么是 Claude 3?它真的能与 ChatGPT 和 GPT-4 匹敌吗?以下是我们目前所知的内容。
要点解读:
AI 竞争激烈: Anthropic 的 Claude 3 是最新例证,表明 AI 领域创新的快速步伐。
大型语言模型(LLM): 这是驱动 ChatGPT 和 Claude 等先进 AI 聊天机器人的核心技术。
模型迭代: Claude 3 的发布代表了 Anthropic 的技术进步,目标是超越 ChatGPT 和谷歌的同类产品。
注意: 对于哪种模型“最好”并没有绝对的答案。这些 AI 系统都十分复杂,在不同任务上的表现会不一样。
Claude 3是什么?Opus、Sonnet、Haiku 解释
Claude 3 是 Anthropic 开发的新系列大型语言模型(LLM),这是一家由亚马逊等公司投资 40 亿美元的人工智能初创公司。该公司与"有效利他主义"运动有一定关联,这意味着它致力于以安全、负责的方式开发人工智能技术,让技术成果造福大众,而不仅仅是股东。
Claude 3 系列包括三个新的LLM,其中能力最强的是 Claude 3 Opus。这是 Anthropic 的全新高级AI模型,仅供 Claude Pro 用户使用。根据该公司的基准测试结果,在研究生级别的推理能力测试中,Opus 的得分达到50.4%,而 GPT-4 的得分为 35.7%。
其次是 Claude 3 Sonnet,这款模型无需购买 Claude Pro 订阅即可使用。当然,它仍然具有强大的能力,其研究生测试成绩为 40.4%(还是对比 GPT-4 的 35.7%)
最后,还有尚未发布的第三个模型 Claude 3 Haiku。在复杂性和大多数功能方面,它处于系列产品线的最底层,但它的设计使其成为速度最快的版本,并提供近乎即时的响应。
Haiku 似乎几乎完全针对企业,而不是日常用户。它的速度意味着它将成为支持网站客户服务的 AI 聊天机器人的强大动力,这些聊天机器人可以帮助您了解想要购买的商品、预订约会以及解决其他问题或投诉。
对于那些需要及时处理大量数据和报告的企业来说,Haiku 也可能是首选。
Claude 3 价格, Claude 3 Opus 花费多少?
正如我们所说,部分 Claude 3 模型需要付费订阅 Claude Pro 才能使用。尤其是最先进的 Claude 3 Opus 版本。
这意味着 Claude 3 Opus 的价格对普通消费者定为每月20美元。企业若想使用则采用的计费方式是定制版 AI 聊天机器人技术常用的“token系统”(基于token计算),Opus 的价格为每百万输入令牌15美元,每百万token输出75美元。
Claude 3 Sonnet 是对全球所有用户开放的 Claude AI 免费版本,Anthropic公司将其形容为“勤恳工作”的模型,企业可以按每百万输入token3美元和每百万输出token15美元的价格接入使用。
目前,Claude 3 Haiku 的价格只有token计价方式:每百万输入token0.25美元,每百万输出token1.25美元。
Claude 3 vs GPT-4 :第一印象
我们仍在测试 Claude 3 相比 ChatGPT 的 GPT-4 等主要竞争对手的功能。因此,我们尚不能分享我们的想法。
话虽如此,Anthropic 已经发布了一些 Claude 3 的性能测试结果,声称展示了 Claude 3 系列如何与 ChatGPT 和 Google 的 Gemini Ultra LLM 相抗衡。
当然,这里最需要注意的是,这些是 Anthropic 自己的测试,或多或少会基于精心设计的提示,旨在最大限度地发挥 Claude 3 的性能。
这并不意味着 Claude 3 没有强大的能力,它看起来非常厉害。但是,在我们自己充分测试之前,还不能最终断言它比 ChatGPT、Gemini 或任何其他聊天机器人好还是差。


我们展示了推理、数学、编码、阅读理解和问题回答的评估结果:

这个表显示了LSAT、MBE(多州律师资格考试)、高中数学竞赛(AMC)和GRE一般考试的评估结果:

多模态任务的评估结果,包括视觉问题回答、图表和文档理解。†表示思维链的提示。除非另有说明,否则所有的评估均为0次射击:

该图说明了claude3作品的图表理解结合多步骤推理的一个例子:

基本大模型能力:
代码:

创意写作:

构建流程:

长文档问答:

多语言:

这幅图显示了人类对非英语任务的偏好获胜率。我们收集了以下语言的偏好数据:阿拉伯语、法语、德语、印地语、日语、韩语、葡萄牙语和简体中文
如果您迫不及待地想看看 Claude 3 对您最常使用的提示的反应,好消息是 Claude 3 Sonnet 现已在全球许多国家/地区的 Claude AI 上推出。
更好的是,使用 Claude 3 非常简单。方法如下:
访问 Anthropic 网站
点击 “试用 Claude” 按钮
使用 Google 账户登录(或创建新账户)
就是这么简单!您现在会进入 Claude AI 的主聊天窗口,可以开始与 Anthropic 的助手互动。如果您喜欢看到的结果,那可以考虑是否要升级到 Opus 以获得其额外功能。
🎉 喂,朋友们!我有一个超级棒的账号要向大家推荐!这个账号的主人就是科林老师!他专注于分享关于跨境电商和AIGC(生成式人工智能)相关的知识和见解,绝对是该领域的疯狂战士!想要获取科林老师的最新动态和深度解读,一定不能错过他的推文!等等,在接下来的文章中,科林将继续实际操作各种实用且有趣的GPT-4插件应用,深入讲解应用落地。请大家务必保持关注。
此外,科林还创建了一个AIGC私享群,定期分享有颜值、有料、有趣、有才华、有价值的干货,带给融入不一样的知识分享,学习体验;
融入国际化思维,视野与时俱进。
欢迎大家加入群组交流。这是一个高质量的精英人脉群

一杯瑞幸咖啡
揭开地表最强AI应用实操的神秘面纱
小册涵盖AI领域是最新信息
你所想到的AI都有
限时10元,喜欢的赶紧入!





