搜索
首页科技周边IT业界刚刚曝光的 Claude3,直击 OpenAI 最大弱点

刚刚曝光的 Claude3,直击 OpenAI 最大弱点

Mar 10, 2024 am 08:07 AM
人工智能openai

企业级 SOTA 大模型,Anthropic 的 Claude3 释放了哪些信号?

作者 | 宛辰

编辑 | 靖宇

作为 OpenAI GPT3 研发负责人的创业项目,Anthropic 被视为最能与 OpenAI 抗衡的一家创业公司。

Anthropic在当地时间周一发布了一组Claude 3系列大模型,声称其功能最强大的模型在各种基准测试中都胜过了OpenAI的GPT-4和Google的Gemini 1.0 Ultra。

但是,能处理更复杂的推理任务、更智能、更快响应,这些跻身大模型 Top3 的综合能力只是 Claude3 的基本功。

Anthropic 致力于成为企业客户的最佳拍档

这是首先体现在 Claude3 是一组模型:Haiku、Sonnet 和 Opus,让企业客户根据自身场景选择不同性能、不同成本的版本。

其次,Anthropic 强调自家模型是最安全的。Anthropic 总裁 Daniela Amodei 介绍,在 Claude3 的训练中引入了一种叫做「宪法人工智能」的技术,增强其安全、可信、可靠

爱丁堡大学大模型和推理方向博士生符尧在阅读完Claude3的技术报告后指出,Claude3在复杂推理的基准测试中表现出色,尤其在金融和医疗领域表现突出。作为一家ToB公司,Anthropic选择专注于优化最具盈利潜力的领域。

现在,Anthropic 在 159 个国家开放使用 Claude3 系列的两款模型(Haiku 和 Sonnet),最强版本 Opus 也即将推出。同时,Anthropic 也通过亚马逊和谷歌的云平台提供服务,后者曾分别向 Anthropic 注资 40 亿美元和 20 亿美元

刚刚曝光的 Claude3,直击 OpenAI 最大弱点
联合创始人 Dario Amodei and Daniela Amodei 表示,Claude 3 的发布再次表明,「Anthropic 更像是一家企业公司,而不是一家消费者公司。」|图片来源:Anthropic

01、更智能、响应更快的 Claude3 家族:Opus、Sonnet 和 Haiku

据 Anthropic 官网,Claude3 是一系列模型,包含三种最先进的模型:Claude 3 Haiku、Claude 3 Sonnet 和 Claude 3 Opus,允许用户为其特定应用选择智能、速度和成本的最佳平衡。

在模型的通用能力上,Anthropic 称 Claude 3 系列「为广泛的认知任务树立了新的行业基准」,在分析和预测、细致内容的生成、代码生成以及西班牙语、日语和法语等非英语语言对话方面,现实出更强大的能力,在任务响应上也更及时。

其中,Claude 3 Opus 是这组模型中最智能的模型,尤其在高度复杂的任务处理上。Opus 在大多数常见的评测基准中都优于同行,包括本科水平专家知识 (MMLU)、研究生水平专家推理 (GPQA)、基础数学 (GSM8K) 等。它在复杂任务上表现出接近人类水平的理解力和流畅性,是目前 Anthropic 对于通用智能最前沿的探索,「展示了生成式人工智能的外部极限」。

刚刚曝光的 Claude3,直击 OpenAI 最大弱点
Claude3 模型家族|图片来源:Anthropic

Claude 3 Sonnet 在智能水平和响应速度之间实现了理想的平衡,尤其对于企业场景下的任务。与同类产品相比,它以更低的成本提供了强大的性能,并且专为大规模人工智能部署中的高耐用性(high endurance)而设计。对于绝大多数工作负载,Sonnet 的速度比 Claude 2 和 Claude 2.1 快 2 倍,且智能水平更高。它擅长执行需要快速响应的任务,例如知识检索或销售自动化。

Claude 3 Haiku 是最紧凑的模型,并且也最具成本效益。并且,它的响应速度也很快,可以在不到三秒的时间内阅读 arXiv 上包含图表、图形的信息以及数据密集的研究论文(约 10k token)。

02、瞄准企业客户的迭代

联合创始人 Daniela Amodei 介绍,除了通用智能的进步,Anthropic 特别关注企业客户把生成式 AI 集成到他们的业务时,所面临的许多挑战。针对企业客户,Claude3 家族在视觉能力、准确性、长文本输入和安全方面,都有进步。

很多企业客户的知识库拥有多种格式,PDF、流程图或演示幻灯片。现在,Claude 3 系列模型可以处理各种视觉格式的内容,包括照片、图表、图形和技术图表。

Claude3 还优化了准确性和长文本窗口的能力。

在准确性上,Anthropic 使用了大量复杂的事实问题来针对当前模型中已知的弱点,将答案分为正确答案、错误答案(或幻觉)和承认不确定性。相应地,Claude3 模型表示它不知道答案,而不是提供不正确的信息。其中最强的版本 Claude 3 Opus 在具有挑战性的开放式问题上的准确性(或正确答案)上,比 Claude 2.1 提高了一倍,同时也减少了错误答案的水平。

刚刚曝光的 Claude3,直击 OpenAI 最大弱点
相比 Claude2.1 版本,Claude3 系列全面提升了响应的准确性。|图片来源:Anthropic

同时,由于语境理解能力的提升,Claude3 家族相比之前的版本,在响应用户任务上会作出更少的拒绝回答。

除了更准确的回复,Anthropic 称将在 Claude 3 带来「引用功能,可以指向参考材料中的精确句子来验证他们的答案

当前,Claude 3 系列模型将提供 200K token 的上下文窗口。后续,所有这三种模型都能够接受超过 100 万 token 的输入,这部分能力会提供给需要增强处理能力的精选客户。Anthropic 在技术报告中简单阐述了 Claude3 的上文本窗口能力,包括有效处理更长的上下文提示词,以及回忆能力。

03、「宪法人工智能」,应对「不精确的科学」

值得注意的是,Claude3 作为多模态模型,可以输入图像,但无法输出图像内容。联合创始人 Daniela Amodei 称,这是因为「我们发现企业对图像的需求要少得多」。

Claude3 的发布是在谷歌 Gemini 生成图片引发争议后发布的,面向企业客户的 Claude 也免不了在 AI 所引发的价值观偏见等问题上的控制与平衡。

对此,Dario Amodei 强调了控制人工智能模型的难度,称其为「不精确的科学」。他表示,该公司有专门的团队致力于评估和减轻模型带来的各种风险。

另一位联合创始人 Daniela Amodei 也承认,用目前的方法可能无法实现完全无偏见的人工智能。「创建一个完全中立的生成式人工智能工具几乎是不可能的,不仅在技术上,而且还因为并不是每个人都同意什么是中立。」她说。

刚刚曝光的 Claude3,直击 OpenAI 最大弱点
此前,Anthropic 公布了用来对齐大模型的「宪法人工智能」|图片来源:Anthropic

尽管如此,Anthropic 用一种称为「宪法人工智能」方法来尽可能使模型和人类广泛的价值观一致,模型遵循「宪法」中定义的原则来调整优化。

作为 OpenAI 曾经的核心人发人员,Amodei 兄妹的出走跟近日马斯克对 OpenAI 的一纸诉状有相同点,认为 OpenAI 不再是一个非赢利组织,不再遵循最初使命造福人类。有记者问 Amodei,Anthropic 符合你出走创业的愿景吗?

Amodei 说:「处于人工智能发展的前沿,是引导人工智能发展轨迹为社会带来积极成果的最有效方式。」

本文来自微信公众号:极客公园 (ID:geekpark),作者:宛辰

以上是刚刚曝光的 Claude3,直击 OpenAI 最大弱点的详细内容。更多信息请关注PHP中文网其他相关文章!

声明
本文转载于:IT之家。如有侵权,请联系admin@php.cn删除
CNCF ARM64飞行员:影响和见解CNCF ARM64飞行员:影响和见解Apr 15, 2025 am 08:27 AM

该试点程序是CNCF(云本机计算基础),安培计算,Equinix金属和驱动的合作,简化了CNCF GitHub项目的ARM64 CI/CD。 该计划解决了安全问题和绩效

使用GO构建网络漏洞扫描仪使用GO构建网络漏洞扫描仪Apr 01, 2025 am 08:27 AM

此基于GO的网络漏洞扫描仪有效地确定了潜在的安全弱点。 它利用了GO的并发功能的速度功能,包括服务检测和漏洞匹配。让我们探索它的能力和道德

2025年最佳10个最佳免费反向链接检查器工具2025年最佳10个最佳免费反向链接检查器工具Mar 21, 2025 am 08:28 AM

网站建设只是第一步:SEO与反向链接的重要性 建立网站只是将其转化为宝贵营销资产的第一步。您需要进行SEO优化,以提高网站在搜索引擎中的可见度,吸引潜在客户。反向链接是提升网站排名的关键,它向谷歌和其他搜索引擎表明您的网站权威性和可信度。 并非所有反向链接都有利:识别并避免有害链接 并非所有反向链接都有益。有害链接会损害您的排名。优秀的免费反向链接检查工具可以监控链接到您网站的来源,并提醒您注意有害链接。此外,您还可以分析竞争对手的链接策略,从中学习借鉴。 免费反向链接检查工具:您的SEO情报员

See all articles

热AI工具

Undresser.AI Undress

Undresser.AI Undress

人工智能驱动的应用程序,用于创建逼真的裸体照片

AI Clothes Remover

AI Clothes Remover

用于从照片中去除衣服的在线人工智能工具。

Undress AI Tool

Undress AI Tool

免费脱衣服图片

Clothoff.io

Clothoff.io

AI脱衣机

AI Hentai Generator

AI Hentai Generator

免费生成ai无尽的。

热门文章

R.E.P.O.能量晶体解释及其做什么(黄色晶体)
4 周前By尊渡假赌尊渡假赌尊渡假赌
R.E.P.O.最佳图形设置
4 周前By尊渡假赌尊渡假赌尊渡假赌
R.E.P.O.如果您听不到任何人,如何修复音频
4 周前By尊渡假赌尊渡假赌尊渡假赌
WWE 2K25:如何解锁Myrise中的所有内容
1 个月前By尊渡假赌尊渡假赌尊渡假赌

热工具

SublimeText3汉化版

SublimeText3汉化版

中文版,非常好用

Atom编辑器mac版下载

Atom编辑器mac版下载

最流行的的开源编辑器

VSCode Windows 64位 下载

VSCode Windows 64位 下载

微软推出的免费、功能强大的一款IDE编辑器

禅工作室 13.0.1

禅工作室 13.0.1

功能强大的PHP集成开发环境

DVWA

DVWA

Damn Vulnerable Web App (DVWA) 是一个PHP/MySQL的Web应用程序,非常容易受到攻击。它的主要目标是成为安全专业人员在合法环境中测试自己的技能和工具的辅助工具,帮助Web开发人员更好地理解保护Web应用程序的过程,并帮助教师/学生在课堂环境中教授/学习Web应用程序安全。DVWA的目标是通过简单直接的界面练习一些最常见的Web漏洞,难度各不相同。请注意,该软件中