人为安全报告:禽流感、无人机群、大规模监视

如果人类像前 Anthropic 员工所声称的那样,终结在人工智能手中,那会是什么样子?

机器人会侵入我们的核武库并让它们在空中飞行吗?先进的算法会设计出一种全新的病毒来释放给人类吗?难道只是慢慢侵蚀我们对同胞的信任,直到混乱降临那么简单吗?

我们真的不知道,但是 新的安全报告 来自 Anthropic 的文章详细介绍了人工智能可能陷入混乱的几种方式,这已经足够令人震惊了。

参见:

人类研究人员辞职,称人工智能“可能在本十年末杀死我们所有人”

个人尝试使用人择人工智能来开发生物武器

Anthropic 的报告——公司正在进行的工作的一部分 透明度 和监控工作——全面概述了过去八个月威胁行为者试图利用其生成式人工智能聊天机器人 Claude 进行“恶意”活动的情况。许多涉及该公司所谓的“非典型”用例的例子涉及国家资助的团体、间谍软件供应商和政府宣传人员。

Anthropic将此类活动分为七个“损害领域”:网络行动、影响力行动、监视、欺骗和欺诈、生物滥用、常规武器开发和蒸馏。在大多数情况下,Anthropic 没有提供有关活动持续时间的详细信息。

在报告中,该公司的威胁情报团队描述了有关克劳德用于生物武器开发的潜在用途的五个已知案例研究。

该公司声称,包括国家支持的用户在内的研究人员敦促克劳德撰写单独的拨款申请,以对蚊媒基孔肯雅病毒和正痘病毒进行实验。后者是导致人类疾病(包括天花)的病毒家族。

Anthropic 表示,其用户“规避了控制措施”,这些控制措施旨在阻止无法访问 Claude 的国家/地区的个人使用该产品。用户还试图隐藏他们研究的目的,显然是为了规避安全措施。

Anthropic 将每个案例研究中的个人描述为工作科学家,但该公司没有透露他们的名字。

该公司在报告中写道:“我们并不声称他们意图造成伤害,识别他们或他们的实验室可能会让他们受到伤害。” Anthropic 表示,在发现用户的活动后,它禁止了这些用户的帐户,并将其发现纳入正在进行的安全工作中。

克劳德为武装无人机、导弹和武器构建了软件

报告解释说,Anthropic 的机器人被部署来构建和完善用于武器开发的软件,包括能够设计、构建和测试真实弹药的技术。

该公司解释说:“从历史上看,此类工作是由政府、联合国专家组和第三方研究人员发现的,他们通过回收的硬件和公共资源将其拼凑在一起。”

Anthropic 将其中一个账户归因于一名俄罗斯自由职业特工,该特工正在执行一项名为“Operation ‘DronDoc’ 或 ‘Serafim”的行动,该账户使用 Claude Code 开发了“全栈自主第一人称视角 (FPV) 神风队无人机群”。

该公司还声称,一个中国账户(可能是一名军工研究人员)使用克劳德的工具创建电子战模块,旨在躲避敌方雷达和通信并压制防空系统。用户的模拟包括台湾的12个目标。

克劳德监视外国持不同政见者并建立大规模监视系统

Anthropic 描述了克劳德被用来“建立、执行或以其他方式促进”国家资助的海外监视活动(包括中国、伊朗和西非国家)以及雇用监视网络的九个实例。

在一个案例中,克劳德被一个疑似与中华人民共和国有联系的行动利用,追踪、分析和招募与叙利亚军方有联系的有政治关系的维吾尔人和记者。克劳德使用来自受监控的 WhatsApp 和 Telegram 聊天记录的大量数据来分析个人。

在另一个案例中,至少有 16 个与伊朗准军事和国土安全部门相关的账户与克劳德构建的监视和恶意浏览器扩展程序相关联,这些扩展程序随后被用来收集 6,388 名伊朗人的数据。一名“伊朗关系威胁者”还利用克劳德来定位美国海军目标。

在所有情况下,生成式人工智能都被用来取代人类监视操作,利用个人数据加速创建目标档案,并促进政府观察员的日常工作。该公司指出,根据其当前的使用政策,用户不得使用其人工智能系统进行“未经同意的监视”和分析。

克劳德帮助网络间谍活动实现自动化

报告中的 Anthropic 声称,人工智能使“威胁行为者”能够实现网络操作的自动化。在 Anthropic 分享的案例研究中,这些人依靠多代理“框架”进行探索和利用,试图窃取敏感信息。

报告中指定为 GTG-20006 的一名参与者通过使用人工智能变得更快。人性声称,除了与美国外交政策相关的组织和个人外,此人还针对乌克兰和欧洲政府的军事情报目标。

GTG-20006,Anthropic 将其描述为俄罗斯间谍特工,利用人工智能执行网络钓鱼、ClickFix 和域名系统 (DNS) 劫持计划。

Anthropic 还声称,该用户以军用无人机制造商和制造商为目标,并渗透到至少三个酒店供应商中,以乌克兰政府官员和无人机制造商等酒店客人的设备为目标。

Anthropic 提供了人工智能网络行动的其他示例,让我们了解了小型犯罪集团和国家资助组织的活动。

Anthropic 表示:“人工智能的传播创造了公平的竞争环境,让两类参与者都能获得相同的高级功能。”

人工智能的安全性引起了人们对监管的兴奋

该公司写道:“我们发布这项工作是因为我们相信我们有责任揭露对我们服务的恶意滥用。随着模型的能力越来越强,除非人工智能开发人员和社会倡导者采取行动使它们更加安全,否则它们的风险将会增加。”

整个行业的一波流氓人工智能活动引发了对监管的强烈攻击。人类最近联合签署 领先的人工智能监控法律 加利福尼亚州。

其中一项法案将建立一个独特、独立的审计登记处,由经过审查的外部评估员组成。第二项法案创建了一个根据现有州法律评估人工智能系统和公司的框架。

这些法案还得到了竞争对手 OpenAI 的支持,该公司在州长加文·纽瑟姆 (Gavin Newsom) 将其签署成为法律的几天前就表示支持该法案。本周早些时候,OpenAI 宣布正在探索一个新框架,以警告公众有关漫游人工智能代理的信息。