Anthropic近日发布年度AI安全威胁情报报告,系统性梳理了大模型被恶意利用的最新趋势。报告涵盖黑客利用Claude策划网络攻击、实施社会工程监控以及尝试指导生物与武器制造的数十起案例。公司强调虽然此类事件尚未大规模泛滥,但清晰揭示了滥用路径的演变方向。Anthropic表示已针对性部署防护机制成功阻断全部涉案行为,并将部分高危线索移交执法机构与其他AI企业共享,凸显行业联防共治的紧迫性。
关键要点
- 报告系统梳理Claude被用于网络攻击及生物武器制造等高危场景
- 公司确认已针对性部署防护机制并成功阻断全部涉案行动
- 高危线索已移交执法机构并推动跨企业情报共享联防机制