花絮3-1 科普天团谈攻防专家在AI反诈中的作用
9月10日,人工智能公司Anthropic发布了其第三份威胁情报报告,披露在过去八个月中,其AI模型Claude被用于可能支持生物武器研发的研究,公司已阻止了多起潜在风险案例。与此同时,该公司多名研究人员公开表达了对AI失控风险的担忧,而特斯拉CEO埃隆·马斯克则将这一连串警告称为“心理战”。围绕同一事件,两种截然不同的叙事正在撕裂AI行业的公共讨论空间。
据公开信息,过去三年曾先后在Anthropic和OpenAI工作的研究员雅各布·考克森于9月8日在社交平台X上宣布辞职,警告两家公司正在推进能够“自我改进”的AI模型,这些模型最终可能强大到人类无法控制。Anthropic现任员工埃文·哈宾格随后回应称,他个人认为未来十年内AI导致灾难性后果的概率超过10%。Anthropic从事安全研究的萨缪尔·马克斯则写道,通常员工级别越高,他们对AI风险的担忧就越深。
马斯克在X上回应相关讨论时称“这听起来像是个阴谋局”。他随后进一步表示,这些帖文的传播看起来像是经过“精心编排”的,是“心理战”的一根火柴。对冲基金Pershing Square首席执行官比尔·阿克曼转发了相关帖文并简短评论“有意思”。
这场争论的核心事实锚点是Anthropic同日发布的威胁情报报告。报告披露,在2025年12月至2026年8月期间,公司识别并阻断了涉及七个危害领域的恶意活动,包括网络攻击、政治影响操作、监控、***、生物滥用、常规武器开发和模型蒸馏。
[IMG:1]生物滥用是报告中最引人关注的部分。Anthropic详细描述了五起案例,其中包括有研究者试图借助Claude撰写关于基孔肯雅病毒功能增益研究的资助申请书,该研究旨在通过基因改造使病毒在反复感染活体动物过程中具有更强的致病性。Anthropic威胁情报负责人雅各布·克莱因表示,识别出该工作原计划在一家军事研究机构开展,这一点尤其令人担忧。公司同时强调,涉案人员均为在职科学家,并未断言其意图造成伤害,因此未披露其姓名和所属机构。
报告同时指出,这些案例中涉及的模型并非Anthropic最新、能力最强的Fable或Mythos级模型,暗示新一代模型的安全防护措施已有所加强。
从商业层面看,Anthropic正处于高速扩张期。2026年5月,公司完成650亿美元H轮融资,投后估值达到9650亿美元,首次超越竞争对手OpenAI的8520亿美元,成为全球估值最高的AI初创企业。领投方包括Altimeter Capital、Dragoneer、Greenoaks和红杉资本,公司年化收入已突破470亿美元。
企业市场的表现同样强劲。据美国企业信用卡与财务自动化平台Ramp发布的2026年4月AI指数报告,Anthropic的企业AI采用率达到34.4%,超过OpenAI的32.3%,而一年前这个数字仅为9%。在2026年首次采购AI服务的企业中,约70%的直接竞争场景最终选择了Claude。Anthropic目前拥有超过30万家企业客户,财富10强中有8家是其付费客户。
[IMG:2]然而,安全承诺的演变正在成为Anthropic面临的核心矛盾。据《时代》周刊报道,2026年2月,Anthropic修改了其“负责任扩展政策”,收窄了必须推迟模型开发或发布的条件。公司解释称,单方面停下并不能阻止竞争对手前进,安全承诺也必须考虑中美竞争和行业现实。这一调整标志着Anthropic从2023年“除非能提前保证安全措施充分,否则绝不训练AI系统”的立场出现了显著转向。
与此同时,竞争对手OpenAI的安全团队也在经历剧烈震荡。据《金融时报》报道,OpenAI已于2026年7月底正式解散了安全预备团队,该团队原本负责评估AI模型是否构成严重安全隐患。包括伦理道德负责人克洛伊·巴卡拉尔、首席未来学家乔什·阿奇亚姆和安全主管约翰内斯·海德克在内的多位关键人物相继离职。早前从OpenAI辞职的扬·雷克在接受采访时批评称,公司正为了推出“闪亮的新产品”而将安全问题抛诸脑后。
监管层面,全球AI治理正在从立法文本走向实际执法。欧盟《人工智能法》关于通用AI模型的规则已于2025年8月生效,透明度义务自2026年8月起适用,违规最高罚款为3500万欧元或全球年营业额的7%。美国方面,白宫于2026年3月发布《国家人工智能政策框架立法建议》,以维持美国全球AI主导地位为目标,试图统一联邦监管并限制各州分散立法。
[IMG:3]安全事件数据的上升趋势为这些监管行动提供了背景。据斯坦福大学发布的《2026年人工智能指数报告》,2025年被记录在案的人工智能安全事件数量从上一年的233起跃升至362起,增幅超过55%。该报告同时指出,前沿AI企业的透明度不升反降,模型训练数据来源、能耗信息和安全评估结果的披露程度持续下滑。
在企业侧,AI安全正在催生一个新的市场。咨询机构Gartner预测,2026年企业AI安全工具支出将达到283亿美元,较2025年增长83%,预计2027年将接近478亿美元。2026年4月至9月间,风险资本向12家企业AI智能体安全与治理公司投入了4.35亿美元。Anthropic自身也于2026年4月推出Glasswing计划,向CrowdStrike、Palo Alto等网络安全公司提供前沿模型Mythos及1亿美元使用额度。
但从行业整体看,安全投入仍远落后于能力扩张。据业内人士估算,全球AI安全支出仅为513亿美元,在整体AI预算中的占比低至2%左右。这意味着,绝大多数AI算力和研发资源仍然流向了能力提升而非风险防控。
对于Anthropic而言,当前的处境折射出前沿AI公司的共同困境。公司估值和营收的增长依赖于持续推出更强大的模型,而其安全品牌的核心承诺——在能力与风险之间保持审慎平衡——正面临越来越大的商业压力。考克森的辞职和内部研究人员的公开表态,将这种张力从公司内部推向了公共视野。而马斯克等人的“心理战”指控,则从另一个方向提出了质疑:安全警告究竟是真诚的风险提示,还是服务于监管议程的公关策略?目前,这一问题尚无定论,但围绕它的争论本身,已经成为AI行业治理进程中不可忽视的一部分。
本文由AI辅助生成


