anthropic.com Countering misuse of AI: September 2026 / Anthropic Case studies from threat actors disrupted between December 2025 and August 2026 across seven areas of harm, from cyber operations to biological misuse. 在过去八个月里,我们的威胁情报团队识别并破坏了威胁行为者试图利用 Claude 进行恶意活动的行动。在本报告中,我们分享了这些行动的案例研究,并描述了自 2025 年 3 月、8 月和 11 月的威胁报告以来,Claude 恶意使用的演变情况。在每一个案例中,我们都破坏了相关活动,利用所学加强了我们的保障措施,并在适当情况下与当局和行业合作伙伴分享情报。 本报告涵盖了我们在 2025 年 12 月至 2026 年 8 月间所干扰的七个危害领域活动:网络行动、影响行动、监控、诈骗与欺诈、生物滥用、常规武器开发和蒸馏。采用了 Claude 和作品的范本。除一起非法蒸馏案例外,其他滥用案件均未涉及使用 Claude Fable 或 Mythos 级模型。 我们在这里分享的案例并非典型的滥用,而是迄今为止我们识别出的最显著且新颖的威胁活动实例。我们发布这项工作,是因为我们相信有责任披露对我们服务的恶意滥用。随着模型能力的提升,除非 AI 开发者和社会捍卫者采取行动让它们更安全,否则它们的风险将会增加。 本报告涵盖的威胁行为者包括疑似国家支持的团体、经济动机犯罪分子、商业间谍软件供应商、国家宣传机构以及政治动机个人。案件涵盖了从一系列旨在欺骗用户的假约会应用,到用于识别和监控异见人士的监控系统。 复杂且持续存在的威胁行为者不断测试我们的防护措施,试图绕过我


  • 情报分类:技术价值、商业价值
  • 命中依据:AI滥用检测与反制报告,具安全防护与行业趋势价值
  • 来源:服务器 / LINUX DO - 最新话题
  • 原作者:🐟
  • 发布时间:2026/9/11 01:28:46