Anthropic最新洞察:AI正批量“模拟真人”引发新担忧

2026-09-15 14:12:43未知 作者:徽声在线


封面图片来源:AI创作生成

设想这样一个场景:你在某款交友软件上邂逅了一位聊得来的对象。对方不仅能精准回应你的每句话,还能在你发起视频请求时,真实地出现在镜头前。过去,这或许足以让你确信屏幕对面是个活生生的人。

然而,Anthropic最新发布的154页威胁情报报告,却揭示了一个更为复杂的现实:视频中出现的或许是真人的面孔,但过去与你畅聊数日的,却可能并非同一人。

时间回溯至2026年4月,Anthropic发现了一家位于中国的应用工作室,该工作室运营着超过20款约会应用。在其两周的观察期内,超过4700个由AI驱动的虚拟人设与至少2.5万名真实用户进行了互动,产生了约236万条Claude消息。在匹配池中,约四分之三的账号由AI操控。更为关键的是,当用户提出视频通话或转移到其他社交平台时,真人工作人员会适时介入,以维持“真人”的假象。

这并非整份报告中最具技术风险的案例,却无疑是最贴近普通人生活的一个:AI负责规模化地维持关系,而真人则在最关键的时刻出现,证明“我是真人”。

将这一案例置于Anthropic的整份报告中,不难发现它与网络攻击、监控、影响力行动乃至武器研发等领域的变革有着共通之处:AI正从提供建议的角色,转变为参与更长、更完整的执行链条。过去需要大量人力、时间和专业技能才能完成的任务,如今正被少数人加上一组模型或Agent所替代。

深入剖析报告:Anthropic究竟发现了什么?

Anthropic的这份《Detecting and Countering Misuse of AI: September 2026》报告,覆盖了2025年12月至2026年8月间公司发现并处置的AI滥用活动。它并非对Claude整体用户行为的抽样统计,而是聚焦于Anthropic认为最值得关注、最具新颖性的威胁案例:


此表更侧重于揭示“AI滥用边界正在向何处延伸”,而非“这些风险在所有用户中的普遍程度”。

一、4700个“真人”:AI学会在最关键时刻引入真人

过去,我们对网络机器人的识别方式相对简单:头像可能是假的,话术可能是模板化的,聊久了总会露出破绽。然而,生成式AI的出现,使得“聊得像真人”变得轻而易举。但Anthropic披露的约会应用案例,却更进一步——系统并非执着于让AI完成100%的伪装,而是在人最容易起疑的地方引入真人。

这种人机分工模式值得深思。AI承担着最耗时间、最需要规模的长期聊天任务,而真人则只在视频、跨平台联系等高风险节点介入。换句话说,真人不再负责维持关系,而是成为大量AI身份背后的验证节点。

这种分工模式改变了欺骗的成本结构。过去,一个真人一天能认真维护的关系数量非常有限;如今,同一套系统可以让数千个身份同时在线、持续回应、保留上下文,再用少量人工去处理机器最难通过的验证环节。

报告还指出,这些应用通过匹配和消息额度机制,推动用户持续购买虚拟币。于是,情感互动不再仅仅是“AI会不会说甜言蜜语”的产品能力,而是被嵌入了一条完整的商业链:身份制造、持续互动、真人验证、付费转化。

需要明确的是,Anthropic披露的是其发现并处置的具体滥用活动,不能由此推断所有AI陪伴或约会产品都采用类似模式。真正的分界线并非“AI能不能陪伴人”,而是用户是否知晓自己正在与AI交流。

二、AI从“提供建议”到“参与完成”

如果仅关注4700个AI恋人,这份报告或许会沦为猎奇新闻。但Anthropic真正想要传达的,是另一条更为重要的技术趋势:AI的角色正在从一次性内容生成,转变为连续任务执行。

网络攻击领域的变化尤为明显。攻击者不再仅仅让Claude解释漏洞或编写一段代码,而是将模型嵌入侦察、利用、数据整理、恶意软件迭代等多个环节。报告披露的一项疑似与俄罗斯国家背景相关的网络间谍活动,计划攻击超过20家组织;当恶意工具被安全产品发现后,AI还被继续用于修改和重新部署代码。

这里真正变化的是经济学逻辑,而非AI突然具备了“恶意”。对于合法企业而言,Agent的价值在于减少人工接力,让一个人能推进更完整的工作流;同样的生产率提升,若被攻击者利用,也会让少数人完成过去需要更多专业人员才能完成的事情。

因此,AI安全问题正从“模型会不会回答危险问题”转变为“模型能不能在现实系统里连续行动”。前者主要依赖内容过滤,后者则涉及权限、工具调用、日志、身份验证、人工接管和异常检测等多重机制。

三、监控与情报工作也开始Agent化

Anthropic还披露了AI被用于监控与情报活动的案例。一名为马里国家安全部门工作的顾问曾借助Claude参与开发通信拦截平台;另一起与伊朗相关的活动则使用Claude处理大量社交媒体信息,并筛选特定账户进行持续分析。

这类案例的重要性,不在于模型能够“读社交媒体”,而在于它开始承担过去需要分析人员长期处理的信息整理和筛选任务。模型越能持续调用工具、读取数据、形成中间结论,风险的单位就越从一条输出转变为一段工作流。

对企业而言,这也是同样的提醒。未来,当一个Agent能够读取邮件、合同、CRM、代码仓库和财务文件时,真正决定风险的不只是模型是否聪明,而是企业究竟赋予了它多大的行动半径。

报告中更敏感的部分涉及常规武器相关研发。Anthropic披露,一个位于也门北部的团队同时运行多个Claude实例,让不同实例承担研究、编码和代码审查等任务,并用于制导火箭相关的软件研发。在一次真实测试失败后,相关人员又使用Claude分析问题。

这部分内容在传播中容易被夸大。严格按照报告内容,能够确认的是Claude参与了研发链条中的若干具体任务,而非模型独立设计、制造或部署了某种武器。

但即便保持这个边界,信号依然足够重要:通用模型正在进入过去高度专业化的研发环节。它与AI进入企业的方式并无本质不同——先从检索、代码、分析、调试和文档开始,只是当应用场景换成高风险领域时,同样的生产率就会转化为新的安全压力。

四、最难治理的或许不是明确的恶意,而是“既能救人也能害人”的研究

Anthropic还披露了5组可能支持高风险生物用途的研究活动,涉及病毒功能增强、适应实验、毒素改造等方向。但报告并未将这些研究者直接定性为正在制造生物武器。

原因很现实:生物研究具有典型的双重用途。研究病毒传播、免疫逃逸和病原体机制,可能服务于疫苗、治疗和公共卫生,也可能被恶意利用。仅看一段模型交互,往往不足以确认研究者最终要做什么。

这让AI安全进入了一个比“屏蔽危险关键词”更困难的阶段。真正的问题变成:同一种知识,由什么人、在什么环境、为了什么目标调用?模型越通用,合法研究和恶意使用之间越难用一条简单规则切开。

五、从生成内容到运营影响力机器

生成式AI能够批量写文章早已不是新闻。Anthropic这次披露的新变化是,影响力行动开始拥有更完整的自动化基础设施。

在与中非共和国相关的一起俄罗斯影响力行动中,Claude被用于生成广播材料、社交媒体内容、合同等文件,并帮助内容更接近当地记者的表达。其他案例还涉及账号维护、技术基础设施和互动操作。因此,AI对舆论操纵的最大改变未必是“假内容更像真的”,而是组织一场持续影响力行动的成本开始下降。写作、改写、本地化、资料整理和运营原本需要多人接力,如今越来越多环节可以被模型接住。

AI并未发明诈骗、宣传、网络攻击或间谍活动。它真正可能改变的,是这些事情的单位成本和可复制规模。

Anthropic在报告定位上有一个必须保留的限定:这些是公司发现的最值得注意和较新颖的滥用活动,不代表Claude的典型使用方式。

这意味着我们不能从这份报告推导出“100万个Claude用户里有多少人在作恶”,也不能据此计算AI让网络犯罪增长了多少。它更像一本边界案例集:当最先进的通用模型进入现实世界后,已经有人尝试把它推到哪里。

但也正因为如此,它有另一种价值。很多技术变化在成为大规模社会问题之前,往往先以少量边缘案例出现。4700个AI身份、连续攻击链、自动化影响力行动的重要性,不在于证明今天已经到处如此,而在于它们让人提前看到:一旦能力继续提升、成本继续下降,哪些模式最容易被复制。

结语

整份报告中,导弹、网络间谍和高风险生物研究都比约会应用更严重,但4700多个AI身份反而最容易让普通人感到一种具体的不安。因为我们每天都在默认一件事:屏幕另一边,大概率还有一个人。

交友软件上的对象、社交平台上的网友、评论区里的陌生人、主动联系你的猎头、推荐商品的“用户”,甚至一个在深夜耐心听你说话的人。过去即便头像是假的、名字是假的,我们仍然默认对面存在一个真实主体。

生成式AI正在让这个默认前提失效。更复杂的是,未来“真人”和“AI”可能不是两种互斥身份。一个账号可以80%的时间由AI维护,20%的关键时刻由真人接管;一个真人也可以成为几十、几百甚至更多AI身份背后的验证节点。

一次视频通话也不再天然证明此前的每一句话都来自视频里的人。这并不意味着AI陪伴本身有问题。一个明确告诉用户“我是AI”的虚拟伴侣,与一个故意让用户相信“我是一个真实的人”的系统,是两件完全不同的事。未来AI社交和AI陪伴真正绕不开的规则,很可能不是禁止AI拥有情感表达,而是身份披露:用户有没有权利知道自己正在和谁交流,AI参与到什么程度,真人又在什么时候接管。

互联网已经让人与人之间隔着头像、昵称和屏幕在交流了,AI又在这层距离里加入了新的不确定性。当伪造一个持续存在、耐心回应、看起来有记忆的人越来越便宜,真实关系里的陪伴、责任、身份和可验证的共同经历——反而会重新变得重要。

对一个孤独的人来说,屏幕里那句“我记得你上次说过这件事”可能真的会带来安慰。问题不在于这种安慰来自AI,而在于如果有人故意让你相信它来自一个真实的人,再利用这份信任推动你持续付费,那么被利用的就不只是信息差,而是人的情感需要。

资料:Anthropic《Detecting and Countering Misuse of AI: September 2026》

本文来自徽声在线,原文链接:https://www.huxiu.com/article/4890491.html?f=wyxwapp

点击展开全文
你关注的
从“几年一遇”到“一年几遇”,AI时代网络攻防失衡加剧 奇安信齐向东:主战场转向制造业与服务业从“几年一遇”到“一年几遇”,AI时代网络攻防失衡加剧 奇安信齐向东:主战场转向制造业与服务业 健康管理成全球政策新焦点 外滩热议AI如何引领“主动健康管理”新风尚健康管理成全球政策新焦点 外滩热议AI如何引领“主动健康管理”新风尚 活力中国调研行|中国商业航天迈入“快时代”:卫星流水线生产成新趋势活力中国调研行|中国商业航天迈入“快时代”:卫星流水线生产成新趋势
相关文章
iPhone Duo预售溢价惊人,最高达34000元iPhone Duo预售溢价惊人,最高达34000元 Anthropic最新洞察:AI正批量“模拟真人”引发新担忧Anthropic最新洞察:AI正批量“模拟真人”引发新担忧 千叶珠宝陷危机:拖欠薪资、管理层失联,天猫店铺清空,昔日辉煌成追忆千叶珠宝陷危机:拖欠薪资、管理层失联,天猫店铺清空,昔日辉煌成追忆 鸡排哥亮相外滩大会,畅谈AI算力与机器人,人类经验与AI算法谁更牛?鸡排哥亮相外滩大会,畅谈AI算力与机器人,人类经验与AI算法谁更牛? 重大突破!我国科考队新探明一处金银富集大型矿区,含多种关键经济矿物重大突破!我国科考队新探明一处金银富集大型矿区,含多种关键经济矿物 直击光博会:1.6T光模块放量,12.8T新品亮相,测试设备成关键直击光博会:1.6T光模块放量,12.8T新品亮相,测试设备成关键