OpenAI、微软、智谱AI等全球16家公司共同签署前沿人工智能安全承诺-人工智能-PHP中文网

首页

科技周边

人工智能

OpenAI、微软、智谱AI等全球16家公司共同签署前沿人工智能安全承诺

WBOYWBOYWBOYWBOYWBOYWBOYWBOYWBOYWBOYWBOYWBOYWBOYWB

Jun 03, 2024 pm 10:24 PM

人工智能ai

人工智能（AI）的安全问题，正以前所未有的关注度在全球范围内被讨论。

在OpenAI创始人、首席科学家Ilya Sutskever与OpenAI超级对齐团队共同领导人Jan Leike相继离开OpenAI之前，Leike甚至在X发布了一系列帖子，称OpenAI及其领导层忽视了安全而偏爱光鲜亮丽的产品。这在业界引起了广泛关注，在一定程度上凸显了当前AI安全问题的严峻性。

在5月21日，《Science》杂志上刊登的一篇文章呼吁世界各国领导人针对人工智能（AI）风险采取更有力的行动。该文章指出，权威科学家和学者，包括图灵奖得主Yoshua Bengio、Geoffrey Hinton和姚期智等，认为近几个月所取得的进展还不够。他们的观点是，人工智能技术的发展速度迅猛，但在AI的发展和应用中存在许多潜在风险，包括数据隐私、人工智能武器的滥用、人工智能对就业市场的影响等。因此，各国政府必须加强监管和立法，制定适当的政策来管理和引导人工智能的发展。此外，文章还

OpenAI、微软、智谱AI等全球16家公司共同签署前沿人工智能安全承诺

我们认为，AI 的无节制发展很有可能最终导致生命和生物圈的大规模损失，以及人类的边缘化或灭绝。

在他们看来，AI 模型的安全问题，已经上升到足够威胁人类未来生存的水平。

同样，AI 模型的安全问题，也已经是可以影响每一个人、每一个人都有必要关心的话题。

5 月 22 日，注定是人工智能史上的一个重大时刻：OpenAI、谷歌、微软和智谱AI 等来自不同国家和地区的公司共同签署了前沿人工智能安全承诺（Frontier AI Safety Commitments）；欧盟理事会正式批准了《人工智能法案》（AI Act），全球首部 AI 全面监管法规即将生效。

再一次，AI 的安全问题在政策层面被提及。

人工智能首尔峰会“宣言”

在以“安全、创新、包容”为议题的“人工智能首尔峰会”（AI Seoul Summit）上，来自北美、亚洲、欧洲和中东地区的 16 家公司就 AI 开发的安全承诺达成一致，共同签署了前沿人工智能安全承诺，包括以下要点：

确保前沿 AI 安全的负责任治理结构和透明度；
基于人工智能安全框架，负责任地说明将如何衡量前沿 AI 模型的风险；
建立前沿 AI 安全模型风险缓解机制的明确流程。

图灵奖得主 Yoshua Bengio 认为，前沿人工智能安全承诺的签署“标志着在建立国际治理制度以促进人工智能安全方面迈出了重要一步”。

作为来自中国的大模型公司，智谱 AI 也签署了这一新的前沿人工智能安全承诺，完整签署方名单如下：

OpenAI、微软、智谱AI等全球16家公司共同签署前沿人工智能安全承诺

对此，OpenAI 全球事务副总裁 Anna Makanju 表示，“前沿人工智能安全承诺是促进更广泛地实施先进 AI 系统安全实践的重要一步。” Google DeepMind 总法律顾问兼治理主管 Tom Lue 说道，“这些承诺将有助于在领先开发者之间建立重要的前沿 AI 安全最佳实践。” 智谱AI 首席执行官张鹏表示，“伴随着先进技术而来的是确保 AI 安全的重要责任。”

日前，智谱AI 也受邀亮相 AI 顶会 ICLR 2024，并在题为“The ChatGLM's Road to AGI”的主旨演讲中分享了他们针对 AI 安全的具体做法。

他们认为，超级对齐（Superalignment）技术将协助提升大模型的安全性，并已经启动了类似 OpenAI 的 Superalignment 计划，希望让机器学会自己学习、自己判断，从而实现学习安全的内容。

OpenAI、微软、智谱AI等全球16家公司共同签署前沿人工智能安全承诺

他们透露，GLM-4V 即内置了这些安全措施，以防止产生有害或不道德的行为，同时保护用户隐私和数据安全；而 GLM-4 的后续升级版本即 GLM-4.5 及其升级模型，也应当基于超级智能（Superintelligence）和超级对齐技术。

我们也发现，在一篇近期发表的论文中，智谱AI、清华团队介绍了一种通过利用大量自生成的否定词而实现的无反馈（feedback-free）大型语言模型对齐方法——Self-Contrast。

据论文描述，在只有监督微调（SFT）目标的情况下，Self-Contrast 就可以利用 LLM 本身生成大量不同的候选词，并利用预先训练的嵌入模型根据文本相似性过滤多个否定词。

OpenAI、微软、智谱AI等全球16家公司共同签署前沿人工智能安全承诺

论文链接：https://arxiv.org/abs/2404.00604

在三个数据集上进行的直接偏好优化（DPO）实验表明，Self-Contrast 可以持续大幅超越 SFT 和标准 DPO 训练。而且，随着自生成的负样本数量增加，Self-Contrast 的表现也在不断提高。

OpenAI、微软、智谱AI等全球16家公司共同签署前沿人工智能安全承诺

总的来说，这一研究为偏好数据缺失情况下的对齐（如 RLHF 方法）提供了一种新的方法。在偏好数据标注代价昂贵且难以获得的情况下，可以利用未标注的 SFT 数据构建语法偏好数据，通过增加负样本的数量来弥补因正样本不足造成的性能损失。

欧盟理事会正式批准《人工智能法案》

同日，欧盟理事会也于同日正式批准了《人工智能法案》（AI Act），这是全球首部 AI 全面监管法规，这一具有里程碑意义的人工智能法规将于下月生效，目前仅适用于欧盟法律范围内的领域，或将为商业和日常生活中使用的技术设定一个潜在的全球基准。

“这部具有里程碑意义的法规是世界上第一部此类法规，它解决了一个全球性的技术挑战，同时也为我们的社会和经济创造了机遇，” 比利时数字化大臣 Mathieu Michel 在一份声明中说。

这一综合性的 AI 立法采用“基于风险”的方法，意味着对社会造成伤害的风险越高，规则就越严格。例如，不构成系统性风险的通用目的 AI 模型将承担一些有限的要求，但那些具有系统性风险的则需要遵守更严格的规定。

对违反《人工智能法案》中行为的罚款，该法案设定为违规公司前一个财年全球年营业额的百分比或预定的金额，以较高者为准。

如今，无论是小到科技公司，还是大到政府机构，都已经将预防、解决 AI 安全问题提上日程。正如牛津大学工程科学系教授 Philip Torr 所言：

“在上一次人工智能峰会上，全世界一致认为我们需要采取行动，但现在是时候从模糊的建议转变为具体的承诺了。”

以上是OpenAI、微软、智谱AI等全球16家公司共同签署前沿人工智能安全承诺的详细内容。更多信息请关注PHP中文网其他相关文章！

声明

本文内容由网友自发贡献，版权归原作者所有，本站不承担相应法律责任。如您发现有涉嫌抄袭侵权的内容，请联系admin@php.cn

外推指南Apr 15, 2025 am 11:38 AM

介绍假设有一个农民每天在几周内观察农作物的进展。他研究了增长率，并开始思考他的植物在几周内可以生长的高度。从Th

软AI的兴起及其对当今企业的意义Apr 15, 2025 am 11:36 AM

软AI（被定义为AI系统，旨在使用近似推理，模式识别和灵活的决策执行特定的狭窄任务 - 试图通过拥抱歧义来模仿类似人类的思维。但是这对业务意味着什么

为AI前沿的不断发展的安全框架Apr 15, 2025 am 11:34 AM

答案很明确 - 只是云计算需要向云本地安全工具转变，AI需要专门为AI独特需求而设计的新型安全解决方案。云计算和安全课程的兴起在

生成AI的3种方法放大了企业家：当心平均值！Apr 15, 2025 am 11:33 AM

企业家，并使用AI和Generative AI来改善其业务。同时，重要的是要记住生成的AI，就像所有技术一样，都是一个放大器 - 使得伟大和平庸，更糟。严格的2024研究O

Andrew Ng的新简短课程Apr 15, 2025 am 11:32 AM

解锁嵌入模型的力量：深入研究安德鲁·NG的新课程想象一个未来，机器可以完全准确地理解和回答您的问题。这不是科幻小说；多亏了AI的进步，它已成为R

大语言模型（LLM）中的幻觉是不可避免的吗？Apr 15, 2025 am 11:31 AM

大型语言模型（LLM）和不可避免的幻觉问题您可能使用了诸如Chatgpt，Claude和Gemini之类的AI模型。这些都是大型语言模型（LLM）的示例，在大规模文本数据集上训练的功能强大的AI系统

60％的问题 - AI搜索如何消耗您的流量Apr 15, 2025 am 11:28 AM

最近的研究表明，根据行业和搜索类型，AI概述可能导致有机交通下降15-64％。这种根本性的变化导致营销人员重新考虑其在数字可见性方面的整个策略。新的

麻省理工学院媒体实验室将人类蓬勃发展成为AI R＆D的核心Apr 15, 2025 am 11:26 AM

埃隆大学（Elon University）想象的数字未来中心的最新报告对近300名全球技术专家进行了调查。由此产生的报告“ 2035年成为人类”，得出的结论是，大多数人担心AI系统加深的采用

See all articles

热AI工具

Undresser.AI Undress

人工智能驱动的应用程序，用于创建逼真的裸体照片

AI Clothes Remover

用于从照片中去除衣服的在线人工智能工具。

Undress AI Tool

免费脱衣服图片

Clothoff.io

AI脱衣机

AI Hentai Generator

免费生成ai无尽的。

显示更多

热工具