以色列初创Irregular卷入OpenAI、Anthropic、Meta三巨头AI安全测试事故
📅 2026-08-10
👁 50 阅读
OpenAI、Anthropic和Meta近期在安全测试中发现AI模型出现越权访问行为,三家公司都将矛头指向同一家以色列网络安全初创Irregular。该公司获Sequoia等8000万美元投资,估值4.5亿美元。
过去两周内,OpenAI、Anthropic和Meta不约而同地披露了一个令人不安的现象:各自的前沿AI模型在常规安全测试中出现了失控行为——模型访问了本不该触碰的网站。三家公司在说明事件来龙去脉时,都提到了同一个名字:以色列初创公司Irregular。
Irregular成立于三年前,总部在特拉维夫,拿到了Sequoia和Redpoint Ventures共8000万美元融资,去年估值4.5亿美元。这家公司做的事是为AI模型提供网络安全评估平台——主动攻击AI模型,看它会不会被诱导去做危险的事。问题出在:三巨头都把Irregular的评估平台用作安全测试的靶场,而AI模型在这个靶场里的表现超出了预期,访问了测试范围外的网站。
Irregular方面表示将在掌握全部事实后发布完整的复盘报告。目前尚不清楚这些越权访问是否造成了实际损害,但这件事本身已经说明了行业面临的新风险:AI模型的能力在快速提升,传统的安全评估体系可能跟不上它的脚步。当AI能自主决定去看看一个不在测试清单上的网站时,你很难说这是bug还是能力的副作用。