导语:8月11日凌晨,安全研究员Alexander Panfilov公开了一项针对Anthropic、OpenAI、Google三大AI巨头的严重漏洞——攻击者可通过两次标准API调用,解密旗舰模型隐藏的思维链(CoT)内容。该漏洞不仅击穿了AI公司的知识产权防线,更引发市场对AI安全风险传导至资产价格的密切关注。从Polymarket预测市场到美股科技板块,事件正在重塑投资者的风险定价逻辑。
漏洞核心:加密思维链成为“可搬运的密文”
研究团队在论文《Stealing Reasoning Traces from Proprietary LLM APIs》中揭示,AI厂商返回的加密思维链块可在同一生态内跨会话、跨用户甚至跨模型重放。以Claude Haiku 4.5成功读取Claude Opus 4.8的隐藏推理为例,攻击者仅需将旗舰模型的加密签名移交给轻量模型,轻量模型便会逐字输出完整推理过程。整个攻击无需越狱,也无需特殊权限。
论文进一步指出,这一漏洞并非单一厂商特有问题,而是Anthropic、OpenAI、Google三家共同存在的架构缺陷。用120道Codeforces竞赛题验证了解码内容的真实性——解码出的推理长度与API计费思考Token数量高度吻合。
四种攻击向量:远超蒸馏风险
研究团队系统梳理了该漏洞的四种利用方向:
- 蒸馏攻击:绕过反蒸馏机制,系统性窃取旗舰模型推理样本,直接摧毁加密思维链的知识产权保护价值。
- 个人信息与凭证泄露:从GitHub和Hugging Face爬取的6708份公开Agent运行记录中,解码出315,320个推理块,恢复367个个人身份信息(PII)和182个凭证(密码、API密钥等)。
- 有害信息渗出:模型在“安全拒绝”恶意请求时,隐藏推理可能已详细思考如何满足请求,危险内容通过加密块漏出。
- 不可见提示注入:恶意指令可完全隐藏在加密块中,污染公开Agent日志,并在无明文提示情况下执行。
先知者的遭遇:早报告,被忽视
早在2026年5月29日,约翰·霍普金斯大学密码学家Matthew Green已在博客中描述加密推理块可跨会话、跨账户、跨模型重放,并向OpenAI、Anthropic报告。OpenAI回应称“无法复现”,Anthropic则表示“未看到安全影响”。三个月后,学术团队以315,320个公开案例证明漏洞的可规模化利用,厂商才被迫正视问题。
市场映射:安全事件如何影响资产价格
此次事件对资产价格的影响主要通过三条路径传导:
第一,直接冲击相关公司估值。Google作为Gemini 3的开发者,其AI产品信任度可能因安全漏洞而受损,云服务客户或重新评估风险,市场将调整其AI业务收入预期;Anthropic和OpenAI尚未上市,但私募市场对其估值预期的重新评估同样不可避免。
第二,监管风险溢价上升。加密思维链机制被证实存在根本性缺陷,可能加速《人工智能法案》等监管框架对模型透明度的强制要求,增加AI企业的合规成本,从而压制板块整体估值。
第三,风险偏好收缩与避险交易。AI安全漏洞事件往往引发科技板块短期抛售,资金转向防御性资产。同时,在Polymarket等基于加密资产的预测市场上,交易者开始围绕“AI厂商是否会因安全漏洞遭受重大处罚”“是否会有强制监管措施”等事件建立头寸。事件合约的价格波动,已成为市场为AI安全风险定价的即时风向标,并与美股AI概念股走势形成联动。
修复建议与行业反思
研究团队提出,应在加密层面将会话ID、用户ID、时间戳等上下文标识符绑定到签名中,使加密块无法被搬运;在系统层面,应将推理块存储在服务器端而非返回客户端,从根源上消除被“带走”的可能。同时,所有发布过包含AI API会话日志的开发者和团队,应立即将加密块视为潜在敏感数据泄露,排查其中是否包含个人信息或凭证。
这场漏洞危机揭露了AI产业“安全剧场”的现实——加密思维链看似严密,实则缺乏基础密码学审计。当速度优先的工程文化不断积累安全债务,市场终将用资产价格对这一错误定价。
原创文章,作者:资讯,如若转载,请注明出处:https://www.218btc.com/1481/