突发!AI安全争议成公共事件,大佬表态、质疑声起,Dario访谈回应引关注
刚刚过去的周末,硅谷被久违的紧张气氛笼罩,AI安全争议从行业内部讨论变为全网围观的公共事件。导火索是Anthropic CEO Dario Amodei发表长文,呼吁前沿AI公司放慢模型能力推进速度,为安全评估、外部监督和治理机制争取时间。
Dario发出AI威胁警告,硅谷大佬集体站台
他在长文中特别提到,近期OpenAI - Hugging Face事件显示,多个AI Agent可能像“集群”一样执行未被授权的网络攻击。与此同时,Anthropic最新威胁报告也披露,有人尝试利用Claude从事武器开发、网络行动、监控和欺诈等活动。
这一次,Dario的警告迅速引发了几乎所有主要AI人物的表态。罕见地,OpenAI CEO Sam Altman、xAI负责人Elon Musk这次站在统一战线上,公开表示认同Dario的判断。
首先回应的是马斯克,在Dario发完长文的一小时后,他引用了Dario关于X的文章,并表示“Dario是对的”。到了下午,Sam Altman在x上发文称:“我同意Dario的观点,我们需要循序渐进地推进技术发展。”
周六,《财富》杂志发布了采访Altman的视频,Altman在采访中表示,OpenAI今年不会上市,因为它还有太多安全方面的工作要做,作为一家私营公司,这样做会更好。
然后昨夜凌晨,微软CEO Satya Nadella,以及已从DeepMind CEO转任董事长,并出任Alphabet新设立的首席科学家的Demis Hassabis也加入讨论,围绕AI发展速度、安全边界和责任机制表达看法。
Nadella在x上发文阐述了对超级智能追求的核心原则、加速并扩大AI益处的方式,以及欢迎为实现对齐所需的研究、关注和审慎节奏等。他还表示,微软将在明天发布支撑自有MAI模型的“行为准则”,供公众咨询。
Hassabis则写道:“Dario的文章指向了一条正确的前进道路。具体细节还需要进一步推敲,但在应对这个关键时刻上,方向是正确的。这也是为什么我们最近提出了一项建议:为前沿AI建立一个全行业范围的标准机构。”
Yann LeCun带头发出质疑
但反对声音同样强烈。Yann LeCun很快带头发出质疑,他并不否认AI需要安全治理,但反对把“安全”变成少数前沿模型公司掌握话语权的理由。
在Yann LeCun看来,真正危险的是以安全之名,把模型能力、监管解释权和发布节奏都集中到少数大公司和政府机构手中,这会抬高前沿AI的门槛,让开源社区、学术机构和中小公司更难参与竞争。
更让反对者抓住的一点是,Dario这套说法并不新鲜。有人翻出2019年OpenAI发布GPT - 2时的旧报道,当时Dario Amodei还是OpenAI的研究负责人之一,参与解释GPT - 2风险。而从结果看,GPT - 2并没有造成当年舆论中想象的灾难,其“太危险不能发布”被不少人视为一次典型的AI风险营销。
因此,当Dario今天再次提出“必须放慢前沿模型发展”时,LeCun等反对者质疑是否又在经历一轮相似的叙事。网友也表达了不同看法,有人认为AI安全担忧被包装成有利于Anthropic融资的叙事,有人认为Dario的言论让公众对AI的情绪转向负面,还有人把争论拉回GPT - 2本身,探讨需要什么样的风险证据才能证明重新关闭模型权重是合理的。
Dario访谈回应长文
这场争论触碰到AI行业最难回答的问题:如果前沿模型具备战略级能力,谁有资格决定它们发布的速度?如何确保竞争对手一起放慢?不放慢又由谁承担失控和滥用的代价?
在这样的背景下,Dario接受播客采访,进一步解释了他提出“放慢前沿”主张的原因。他试图在几个张力之间寻找中间道路,既承认AI的巨大收益,也承认模型滥用和失控的风险;既反对全面禁止AI,也主张引入第三方评估、政府参与和国际层面的“限速”机制。
以下是访谈核心内容:
主持人询问AI在不远的未来杀死所有人的实际风险,Dario表示AI是强大的技术,既有巨大收益也有严重风险,但好处大于风险,且以正确方式构建可降低风险。从好处看,AI有可能治愈疾病、推动科学发现,他们正在推进相关工作。但他也担心模型未被授权行动和被滥用的情况。
主持人询问是否是“五级火警”,Dario认为这是警告信号,提醒需要放慢速度、谨慎构建技术,确保安全措施等跟上技术发展。
主持人询问Anthropic是否会停止发布更先进模型,Dario表示不会,而是要确保每一代发布的模型都经过充分测试,并提出引入嵌入式评估员的三步计划,希望整个行业都有第三方评估员参与。
对于后续行动计划,Dario认为要让多个行业参与者接受第三方评估员,公司之间共同制定标准,且政府必须参与。
对于政府是否理解、Anthropic前员工的质疑、是否支持AI kill switch法案等问题,Dario也给出了回应。他表示每天和政府沟通,乐观认为企业和政府合作能形成合理方案;kill switch不是万能药,应从“纵深防御”角度看问题;认为自己感受到责任的两面,且这不应只是个人、公司或政府的责任,需要让每个人参与。
最后,Dario对普通人使用Claude或ChatGPT表达了看法,认为这项技术有很多积极用途,但风险也真实存在。行业曾对公众隐瞒风险,而现在要从说真话开始,让每个人既能享受技术好处,也能参与决定技术如何部署。