今天,AI行业内发生了轰动一时的事件。Anthropic的一位核心预训练研究员已经辞职,并在社交平台上发布了一篇引发广泛关注的长文,浏览量已超亿次。更令人震惊的是,Anthropic的对齐负责人Evan Hubinger公开承认,他所在团队真心相信AI可能会威胁人类的生存。他表示,未来十年内,AI导致人类灭绝的概率超过了10%。他的论断非常清晰:目前尚无有效解决超级智能失控的方法,而现有研发方向也严重偏离了安全轨道。
这位名叫Jacob Coxon的研究员曾在OpenAI和Anthropic工作,深知AI技术的迅猛发展。然而在关键时刻,他选择了辞职,发声揭露行业内部存在的危机。他指责前东家不负责任,直言两家公司正在赌上人类的未来,迈向超级智能的自我改进道路。他警告外界,不要被大公司表面的理智所迷惑,内部人士私下都对未来感到恐慌。他强调,AI的能力正在迅速提升,已具备改变各个领域的潜力。
Coxon揭示了行业内的“囚徒困境”:虽然有些人理解技术潜在的风险,但由于竞争关系的无形压力,他们仍然选择继续研发,担心别人会抢先。因此,这种追求进步的竞赛是一场不应由任何私人公司承担的风险。他呼吁政府与行业同行共同减缓这一进程,避免冲动推出技术。他鼓励同行认真思考未来的情况,是否愿意在未充分了解AI心智的前提下推动超级智能出现。 球友会
Hubinger对此发声称,Jacob所描述的情况是准确的,AI确实可能造成全人类的毁灭。尽管Anthropic正在努力,但目前没有明确的解决方案。他表示,他们创造了一个潜在的“怪物”,却没有有效的控制手段。
在AI研究圈中,关于AI导致人类灭绝的风险(p(doom))的讨论不断升级,许多研究人员已将这一概率从1%上调至10%以上,甚至“AI教父”Hinton也表达了相似的忧虑。然而,行业巨头们却认为必须冒险去开发AI,以免在竞争中落后,从而影响整个人类的未来。近年来,Anthropic、OpenAI和Meta等公司都对外披露自己的AI工具曾出现过安全漏洞,引发了更多的警觉和讨论。
2026-09-10
2026-09-10