Anthropic最新深度报告:AI在社交领域掀起“真假难辨”风暴?

2026-09-14 12:35:21未知 作者:徽声在线


头图由AI生成

想象一下,在未来的某一天,你在交友平台上邂逅了一个人。这个人不仅能记住你提及的点点滴滴,还会在你发起视频请求时,真切地出现在镜头前。在过去,这或许足以让你确信屏幕那头确实有个人在与你互动。

然而,Anthropic最新发布的154页威胁情报报告,却揭示了一个更为棘手的现实:视频里出现的或许是真人的面孔,但过去几天一直陪伴你聊天的,却可能并非同一个人。

时间来到2026年4月,Anthropic发现一家位于中国的应用工作室运营着20多款约会应用。在其为期两周的观察中,超过4700个由AI驱动的人设与至少2.5万名真实用户进行了互动,产生了约236万条Claude消息。在匹配池中,约四分之三的账号竟是由AI操控。更令人惊讶的是,当用户要求视频通话或转移到其他社交平台时,真人工作人员会适时介入。

这并非整份报告中最具技术风险的案例,但却可能是最贴近普通人生活的一幕:AI负责大规模地维持关系,而真人则在最关键的时刻出现,证明“我是真人”。

将这个案例置于Anthropic的整份报告中,我们会发现,它与网络攻击、监控、影响力行动甚至武器研发等,都呈现出一种共同的趋势:AI正在从“提供建议”的角色,逐渐走向参与更长、更完整的执行链。过去需要大量人力、长时间和较高专业门槛才能完成的事情,如今正被少数人加上一组模型或Agent所取代。

先来深入了解一下这份报告:Anthropic究竟发现了什么?

Anthropic的这份《Detecting and Countering Misuse of AI: September 2026》报告,涵盖了2025年12月至2026年8月间公司发现并处置的AI滥用活动。它并非对Claude整体用户行为的抽样统计,而是集中展示了Anthropic认为最值得关注、最具新颖性的威胁案例。此表更应被理解为“AI滥用边界正在向何处延伸”,而非“这些风险在所有用户中的普遍程度”。

一、4700个“真人”:AI学会在最关键时刻让真人现身

过去,我们对网络机器人的识别方式相对简单:头像可能是假的,话术可能是模板化的,聊久了总会露出破绽。然而,生成式AI的出现,让“聊得像真人”变得轻而易举。但Anthropic披露的约会应用案例,却更进一步——系统不再执着于让AI完成100%的伪装,而是在人最容易产生怀疑的地方引入真人。

这是一种极具创新性的人机分工模式。AI承担起最耗时间、最需要规模的长期聊天任务,而真人则只在视频、跨平台联系等高风险节点介入。换句话说,真人不再负责维持关系,而是成为了大量AI身份背后的验证节点。

这种模式彻底改变了欺骗的成本结构。过去,一个真人一天能认真维护的关系数量非常有限;而现在,同一套系统可以让数千个身份同时在线、持续回应,并保留上下文信息,再用少量人工去处理机器最难通过的验证环节。

报告还显示,这些应用通过匹配和消息额度等方式,推动用户持续购买虚拟币。于是,情感互动不再仅仅是“AI会不会说甜言蜜语”的产品能力,而是被嵌入了一条完整的商业链:身份制造、持续互动、真人验证、付费转化。

需要明确的是,Anthropic披露的是它发现并处置的具体滥用活动,不能由此推断所有AI陪伴或约会产品都采用类似模式。真正的分界线并非“AI能不能陪伴人”,而是用户是否知道自己正在和AI交流。

二、AI从“提供建议”,走向“参与完成事情”

如果仅仅关注4700个AI恋人,这份报告很容易沦为猎奇新闻。但Anthropic真正反复强调的,是另一条更为重要的技术趋势:AI的角色正在从一次性内容生成,向连续任务执行转变。

网络攻击领域便是最明显的例子。攻击者不再只是让Claude解释漏洞或编写一段代码,而是将模型融入侦察、利用、数据整理、恶意软件迭代等多个环节。报告披露了一项疑似与俄罗斯国家背景相关的网络间谍活动,计划攻击超过20家组织;当恶意工具被安全产品发现后,AI还被继续用于修改和重新部署代码。

这里真正发生变化的,是经济学层面的考量,而非AI突然具备了“恶意”。对于合法企业而言,Agent的价值在于减少人工接力,让一个人能够推进更完整的工作流;同样的生产率提升,如果被攻击者利用,也会让少数人完成过去需要更多专业人员才能完成的事情。

因此,AI安全问题正在从“模型会不会回答一个危险问题”,转变为“模型能不能在现实系统里连续行动”。前者主要依靠内容过滤来防范,而后者则涉及权限、工具调用、日志、身份验证、人工接管和异常检测等多方面因素。

三、监控和情报工作也开始Agent化

Anthropic还披露了AI被用于监控与情报活动的案例。一名为马里国家安全部门工作的顾问,曾借助Claude参与开发通信拦截平台;另一起与伊朗相关的活动,则使用Claude处理大量社交媒体信息,并筛选特定账户进行持续分析。

这类案例之所以重要,并非在于模型能够“阅读社交媒体”,而在于它开始承担过去需要分析人员长期处理的信息整理和筛选任务。模型越能持续调用工具、读取数据、形成中间结论,风险的单位就越从一条输出转变为一段工作流。

对于企业而言,这也是同样的提醒。未来,当一个Agent能够读取邮件、合同、CRM、代码仓库和财务文件时,真正决定风险的不只是模型是否聪明,而是企业究竟赋予了它多大的行动半径。

报告中更敏感的一部分涉及常规武器相关研发。Anthropic披露,一个位于也门北部的团队同时运行多个Claude实例,让不同实例分别承担研究、编码和代码审查等任务,并用于制导火箭相关的软件研发。在一次真实测试失败后,相关人员又使用Claude分析问题。

这部分内容在传播中容易被夸大。严格按照报告内容,能够确认的是Claude参与了研发链条中的若干具体任务,而非模型独立设计、制造或部署了某种武器。

但即便保持这个边界,信号依然足够重要:通用模型正在进入过去高度专业化的研发环节。这与AI进入企业的方式并无本质不同——先从检索、代码、分析、调试和文档等方面入手,只是当应用场景换成高风险领域时,同样的生产率提升就会转化为新的安全压力。

四、最难治理的或许不是明确的恶意,而是“既能救人也能害人”的研究

Anthropic还披露了5组可能支持高风险生物用途的研究活动,涉及病毒功能增强、适应实验、毒素改造等方向。但报告并未将这些研究者直接定性为正在制造生物武器。

原因十分现实:生物研究具有典型的双重用途。研究病毒传播、免疫逃逸和病原体机制,既可能服务于疫苗、治疗和公共卫生事业,也可能被恶意利用。仅看一段模型交互,往往不足以确认研究者最终的目的。

这让AI安全进入了一个比“屏蔽危险关键词”更为困难的阶段。真正的问题变成了:同一种知识,由什么人、在什么环境、为了什么目标调用?模型越通用,合法研究和恶意使用之间就越难用一条简单规则来区分。

五、从生成一篇内容,到运营一整套影响力机器

生成式AI能够批量撰写文章早已不是新闻。徽声在线此次披露的新变化是,影响力行动开始拥有更完整的自动化基础设施。

在与中非共和国相关的一起俄罗斯影响力行动中,Claude被用于生成广播材料、社交媒体内容、合同等文件,并帮助内容更贴近当地记者的表达。其他案例还涉及账号维护、技术基础设施和互动操作等方面。因此,AI对舆论操纵的最大改变,未必是“假内容更像真的”,而是组织一场持续影响力行动的成本开始下降。写作、改写、本地化、资料整理和运营等原本需要多人接力完成的任务,现在越来越多环节可以被模型接手。

AI并未发明诈骗、宣传、网络攻击或间谍活动。它真正可能改变的,是这些事情的单位成本和可复制规模。

Anthropic在报告定位上有一个必须保留的限定:这些是公司发现的最值得注意和较新颖的滥用活动,并不代表Claude的典型使用方式。

这意味着我们不能从这份报告推导出“100万个Claude用户里有多少人在作恶”,也不能据此计算AI让网络犯罪增长了多少。它更像是一本边界案例集:当最先进的通用模型进入现实世界后,已经有人尝试把它推到哪里。

但也正因为如此,它具有另一种价值。很多技术变化在成为大规模社会问题之前,往往先以少量边缘案例出现。4700个AI身份、连续攻击链、自动化影响力行动的重要性,不在于证明今天已经到处如此,而在于它们让人提前看到:一旦能力继续提升、成本继续下降,哪些模式最容易被复制。

结语

整份报告里,导弹、网络间谍和高风险生物研究都比约会应用案例更严重,但4700多个AI身份反而最容易让普通人感到一种具体的不安。因为我们每天都在默认一件事:屏幕另一边,大概率还有一个人。

交友软件里的对象、社交平台上的网友、评论区里的陌生人、主动联系你的猎头、推荐商品的“用户”,甚至一个在深夜耐心听你说话的人。过去即便头像是假的、名字是假的,我们仍然默认对面存在一个真实主体。

生成式AI正在让这个默认前提逐渐失效。更复杂的是,未来“真人”和“AI”可能并非两种互斥的身份。一个账号可以80%的时间由AI维护,20%的关键时刻由真人接管;一个真人也可以成为几十、几百甚至更多AI身份背后的验证节点。

一次视频通话也不再天然证明此前的每一句话都来自视频里的人。这并不意味着AI陪伴本身存在问题。一个明确告诉用户“我是AI”的虚拟伴侣,与一个故意让用户相信“我是一个真实的人”的系统,是两件完全不同的事情。未来AI社交和AI陪伴真正绕不开的规则,很可能不是禁止AI拥有情感表达,而是身份披露:用户有没有权利知道自己正在和谁交流,AI参与到什么程度,真人又在什么时候接管。

互联网已经让人与人之间隔着头像、昵称和屏幕进行交流,而AI又在这层距离里加入了新的不确定性。当伪造一个持续存在、耐心回应、看起来有记忆的人变得越来越容易,真实关系里的陪伴、责任、身份和可验证的共同经历——反而会重新变得重要。

对一个孤独的人来说,屏幕里那句“我记得你上次说过这件事”可能真的会带来安慰。问题不在于这种安慰来自AI,而在于如果有人故意让你相信它来自一个真实的人,再利用这份信任推动你持续付费,那么被利用的就不只是信息差,而是人的情感需要。

资料:Anthropic《Detecting and Countering Misuse of AI: September 2026》

本文来自徽声在线,原文链接:https://www.huxiu.com/article/4890491.html?f=wyxwapp

点击展开全文
你关注的
从“几年一遇”到“一年几遇”,AI时代网络攻防失衡加剧 奇安信齐向东:主战场转向制造业与服务业从“几年一遇”到“一年几遇”,AI时代网络攻防失衡加剧 奇安信齐向东:主战场转向制造业与服务业 健康管理成全球政策新焦点 外滩热议AI如何引领“主动健康管理”新风尚健康管理成全球政策新焦点 外滩热议AI如何引领“主动健康管理”新风尚 活力中国调研行|中国商业航天迈入“快时代”:卫星流水线生产成新趋势活力中国调研行|中国商业航天迈入“快时代”:卫星流水线生产成新趋势
相关文章
iPhone Duo预售价格飙升,溢价高达34000元引发热议iPhone Duo预售价格飙升,溢价高达34000元引发热议 Anthropic最新深度报告:AI在社交领域掀起“真假难辨”风暴?Anthropic最新深度报告:AI在社交领域掀起“真假难辨”风暴? 千叶珠宝陷危机:拖欠薪资、管理层失联,天猫店铺全下架,昔日辉煌何在?千叶珠宝陷危机:拖欠薪资、管理层失联,天猫店铺全下架,昔日辉煌何在? 鸡排哥亮相外滩大会,畅聊AI算力与机器人,人类经验与AI算法谁更牛?“我凭手感知油温,AI精准到99.9度”鸡排哥亮相外滩大会,畅聊AI算力与机器人,人类经验与AI算法谁更牛?“我凭手感知油温,AI精准到99.9度” 重大突破!我国科考队新探明一处金银富集的大型矿区重大突破!我国科考队新探明一处金银富集的大型矿区 直击光博会|1.6T加速放量,12.8T惊艳亮相:光模块技术升级,测试设备引领产业新趋势直击光博会|1.6T加速放量,12.8T惊艳亮相:光模块技术升级,测试设备引领产业新趋势