分类:AI动态 标签:人工智能、大模型、Anthropic、OpenAI


AI 发展速度过快?巨头再度拉响安全警报

近期,人工智能行业再次因「AI 末日」言论陷入舆论漩涡。Anthropic 首席执行官达里奥·阿莫迪(Dario Amodei)公开撰文表示,人工智能行业应当适当放缓发展速度。他指出,从 2026 年夏季开始,AI 协助构建下一代 AI 的能力正在快速演进,若不加节制,技术突破的速度将彻底超越人类的理解与掌控能力。

无独有偶,OpenAI 首席执行官 Sam Altman 在接受采访时也明确表示,今年 OpenAI 不会上市,因为公司必须将精力集中在安全担忧上。他直言:“哪怕冒着 10% 的在本十年结束前杀死所有人的风险,都是不可接受的。”

与此同时,Anthropic 内部也出现了震荡。研究员雅各布·考克森在社交平台宣布辞职,并发出超级 AI 末日警告;其同事埃文·胡宾格随后响应,称未来十年内 AI 毁灭人类的概率超过 10%,并坦言行业目前尚未解决超级 AI 的“一致性”问题。

行业应对:放缓不等于停滞,多方构建安全防线

面对日益加剧的技术失控担忧,Anthropic 提出放缓发展并不等于彻底停滞,而是利用争取来的 1 到 2 年窗口期,将核心资源投入到四个关键领域:

  • 建立工程标准:解决因复杂基础设施、强化学习环境过滤缺陷等执行失误带来的安全漏洞。
  • 对齐训练跟进:确保安全合规训练能够跟上模型能力的扩张,消除偶发且不可预期的违背意图行为。
  • 内部机理探查:提升类似于“模型大脑 fMRI”的技术,深挖模型未言明的隐性动机。
  • 开发评测基准:防止高智能模型伪装对齐或欺骗安全检测。

此外,Anthropic 承诺将向第三方评估机构提供永久性、员工级别的访问权限,使评估人员能够监督安全措施的执行情况并报告相关事件。

资本与技术的双重狂飙

尽管安全警报不断,但前沿AI领域的商业化与资本注入并未放缓。消息称,英伟达正考虑以基石投资者身份参与 Anthropic 的 IPO,计划投资最多 100 亿美元,助力其估值冲击 2 万亿美元的大关。

与此同时,国内外的 AI 应用落地也在持续推进。DeepSeek 正在 App 端灰度测试 AI 语音对话功能,支持四种不同风格的音色切换,补全了完整的语音交互链路;而在硬件与汽车领域,小米澎程系列与鸿蒙智行问界 M9 Ultimate 领世加长版均在全国开启交付,自动驾驶与大模型座舱正加速走进消费者的日常生活。

总结

当大模型的能力边界不断向通用人工智能(AGI)逼近时,技术狂飙与安全隐患之间的矛盾也愈发尖锐。OpenAI 与 Anthropic 高管及研究员的频频发声,不仅是对全行业的一次理性提醒,也促使人们重新思考:在追求算力与智能极限的同时,如何确保人类始终拥有对技术的绝对掌控力。