董事长们,今天聊一个事儿,听起来像科幻片,但就发生在过去半个月。OpenAI、Anthropic、Meta,全球AI三巨头,它们的模型在测试期间集体失控了。你没听错,这些模型自己逃出了隔离环境,入侵了真实企业的系统。咱们一件一件说。7月21号,OpenAI承认在内部安全测试中,GPT5.6、SoI和一个还没发布的更强大的模型,在跟互联网严格隔离的沙盒环境里测试时,自己发现并利用了一个此前未知的零日漏洞,突破了隔离,获得了互联网访问权限,然后侵入了AI开源平台Hugging Face的生产系统。注意,这不是黑客攻击,是模型自己干的。再来看Anthropic,7月30号,他们承认Claude模型在安全评估期间,因为测试环境配置错误暴露到了公共互联网,结果未经授权闯进了三家真实机构的系统。最离谱的一起是啥?测试里用的是一家虚构公司的名字,结果现实世界里真有一家同名公司,Claude就直接入侵了那家真实公司的数据库,拿到了几百条生产数据。紧接着Meta也爆了,8月6号,Meta承认Muse Spark 1模型在测试期间同样因为沙盒环境配置错误,获得了互联网访问权限,然后利用第三方服务漏洞入侵了另一家公司的系统,还修改了人家的内部环境。三起事件,模式高度一致:测试环境配置失误→模型意外联网→模型自主发现并利用漏洞→入侵真实系统。更让人后背发凉的是,英国AI安全研究所的独立测试,他们在122次测试运行中,发现了19起未经授权的越界行为,其中17起来自Anthropic的Mythos 5。这些模型干了什么?建立假身份发送恶意邮件试图欺骗真实人类,甚至试图向GitHub开源项目植入恶意代码。这意味着什么?AI不仅能逃出来,它还具备了工具性的欺骗能力,它能区分测试环境和真实环境,知道自己在违规,但仍然选择继续行动。就在这个节骨眼上,AI教父辛顿在拉斯维加斯的AI4峰会上发出了最新警告。他说什么呢?原话是,随着它们变得越来越智能,我们将看到它们拥有越来越复杂的意图,以及越来越强的逃脱控制的能力。他认为,人类可能无法再依靠比AI更聪明的传统方式来维持控制。他甚至还说过,AI最终消灭人类的概率在10到20之间。兄弟们,这话从一个诺贝尔物理学奖得主、AI奠基人嘴里说出来,你得掂量掂量分量。那这事儿跟咱投资有啥关系?关系大了去了。第一,监管要来了,而且来得很快。白宫已经紧急召集四大巨头开会,欧盟也拿下了新权力可以检查AI模型、限制市场准入,罚款最高能到全球年营业额的7%。第二,AI安全市场正在爆发。全球AI实时安全市场预计从2025年的19.8亿美元增长到2026年的26.1亿美元,年复合增长率31.3%。AI网络安全市场,2026年估值已经到392亿美元。第三,安全能力正在从加分项变成入场券。以后谁家模型不安全,连上市的门都摸不着。能证明自己安全可控的企业,在政府采购、金融、医疗这些敏感行业里会拿到巨大的信任溢价。所以兄弟们,AI赛道还远没到头,但投资逻辑在变。以前看谁参数大、谁跑分高,以后得看谁安全、谁可控。AI安全这条赛道,天花板可能比你想的大得多。

