近日,人工智能安全公司Anthropic发布年度威胁分析报告,揭示一个关键事实:在其过去一年封禁的恶意账户中,约67%明确利用其AI模型(如Claude)进行网络攻击的前期准备——包括漏洞挖掘、钓鱼话术生成、社工情报整合及自动化渗透测试脚本编写。这些行为并非发生在黑产专用模型上,而是直接调用公开API或越狱后的合规接口完成。事件发生时间集中于2023年Q4至2024年Q2,主要涉及金融、Web3基础设施及去中心化身份(DID)服务提供商。
这一现象折射出AI安全边界的快速模糊化。传统认知中,AI滥用多集中于内容伪造或深度伪造,但Anthropic数据表明,攻击者已系统性转向‘AI增强型攻防’:将大模型作为智能协作者,而非简单工具。其背后是算力平民化、开源模型激增与API经济成熟三重驱动——攻击者无需自建模型,仅需少量token即可调用高阶推理能力,大幅压缩攻击链路。更值得警惕的是,多数被封账号具备真实企业邮箱与合规注册流程,说明防御体系正面临‘合法外壳包裹非法意图’的新型挑战。
对加密市场而言,短期将加剧基础设施层信任危机:钱包签名验证、跨链桥风控、链上地址聚类等依赖AI辅助审计的模块可能被反向利用,导致部分DeFi协议紧急升级风控策略,引发局部流动性收紧;中长期则倒逼行业重构安全范式——从‘人工规则+静态签名’转向‘动态行为图谱+对抗性训练’。对投资者而言,这不仅是技术风险,更是估值逻辑的再校准:安全属性正从隐性成本显性化为协议核心护城河,未来审计服务商、零知识证明集成度、实时威胁响应能力,或将取代TVL成为新估值锚点。