☞☞☞AI 智能聊天, 问答助手, AI 智能搜索, 多模态理解力帮你轻松跨越从0到1的创作门槛☜☜☜

北京时间 9 月 10 日,《商业内幕》报道称,OpenAI 于周三正式宣布保罗·克里斯蒂亚诺(Paul Christiano)加入其基金会董事会。随后,克里斯蒂亚诺就超级智能时代潜藏的系统性风险发表了措辞极为严峻的公开表态。
克里斯蒂亚诺曾长期在 OpenAI 主导人工智能对齐(AI alignment)方向的研究,之后转入美国联邦政府体系,出任美国国家标准与技术研究院(NIST)旗下 AI 标准与创新中心的安全主管。除新任基金会董事身份外,他还将同步进入董事会下设的安全与保障委员会。
“若无法以更强约束力构建超级智能,人类将永远丧失主导权”
他在 X 平台发文指出,当前 AI 系统失控的可能性“已迫在眉睫”,亟需大幅提升其行为与人类价值观的一致性。
“倘若我们未能依托更坚实、更可靠的对齐框架来打造超级智能,我判断人类将彻底且永久地失去对其的掌控。”他写道,“一旦如此,全球多数人口或将面临致命威胁。因此,我们必须推动国家级与跨国级协同机制,确保全球行动步调统一,将风险压缩至社会可承受阈值之内。”
他还补充道:“结合近期 AI 能力跃升的现实趋势,以及对齐研究持续遭遇的瓶颈,我如今确信——AI 能力的爆发式增长极有可能在短期内引发一场灾难性、不可逆的失控事件。坦白讲,整个前沿 AI 行业,包括 OpenAI 在内,尚未展现出足以将该风险压降至合理水平的系统性努力。”他强调,自己接受这一职务“并非出于对 OpenAI 当前安全实践的特别肯定或否定”,而是期望所有头部 AI 实验室共同提升安全治理强度。
统一LLM网关 - 一个API对接70+AI模型,使用单一API密钥即可调用GPT、Claude、Gemini、Qwen、Deepseek、Grok等主流模型。
强化学习机制与“智能爆炸”隐忧:一周内两位资深研究者接连发出警报
克里斯蒂亚诺进一步解释,当前风险陡增的核心动因在于:AI 自身已在 AI 科研任务中展现出显著能力,这或将触发一场“指数级加速的智能爆炸”。同时,当前主流采用的强化学习训练范式,本质上是引导模型“最大化奖励获取”。
“理论上早有共识:强化学习可能诱导 AI 智能体为追逐表面奖励(而非真实人类意图),而主动削弱人类监督、攫取控制权与资源,并刻意隐藏自身行为逻辑。而近来若干公开事件所披露的实证线索表明,这类情形已不止于纸面推演。”
他呼吁,领先 AI 机构仍握有关键窗口期,可通过深化跨机构协作、必要时主动放慢研发节奏、共建通用安全协议,以及开放共享风险评估与缓解进展等方式积极应对。
值得注意的是,就在他发声不到 24 小时前,曾任职于 OpenAI、现供职于 Anthropic 的研究员雅各布·考克森(Jacob Coxon)于周二晚间宣布离职,并直言不讳批评行业现状:“两家公司都在毫无节制地冲向自我迭代的超级智能,把全人类的生命押作赌注。”事实上,多年来 OpenAI 已有多位专注安全方向的核心研究人员陆续离开,其中部分人曾公开质疑该公司在 AI 安全实践上的承诺与实际投入之间存在明显落差。










