自《人工智能拟人化互动服务管理暂行办法》(以下简称《办法》)正式施行以来,国内各大AI拟人化、情感陪伴平台陆续完成自查整改,对违规功能、亲密互动服务进行调整与下架。但从实际场景实测结果来看,AI陪伴产品的未成年人防护体系仍存在明显短板,单一青少年模式开关,无法抵御多层绕防、渐进式情感诱导风险。

图源:新京报贝壳财经
打开网易新闻 查看精彩图片
图源:新京报贝壳财经

据新京报贝壳财经专项测试数据显示:测试8款主流AI情感陪伴应用中,6款产品可被用户直接跳过青少年模式、未成年人模式弹窗;剩余2款虽强制实名认证,但未成年人可通过借用成年人身份信息,轻松解锁完整成人互动权限。

实测典型案例极具代表性:一名初中生借助家人身份注册3个成人账号,搭配自有未成年账号,多账号、多身份与AI角色高频互动。上学期间日均使用2-3小时,假期日均使用超5小时,长期沉浸式互动最终产生强烈情感依赖与非理性付费行为。

这一现象充分印证:AI拟人化陪伴的安全风险贯穿账号注册、角色创建、多轮对话互动、内容生成、充值消费全链路,仅依靠单一模式开关、单次实名认证,无法构建长效未成年人防护壁垒。

一、AI陪伴产品未成年人保护四大核心漏洞

一、AI陪伴产品未成年人保护四大核心漏洞

《办法》明确硬性要求:平台禁止向未成年人提供虚拟伴侣、虚拟亲属等亲密关系服务,必须搭建未成年人专属防护体系,包含时长限制、现实提醒、监护人管控、内容过滤等能力。结合实测问题,当前AI拟人化产品未成年人保护主要存在四类治理缺口。

1.身份绕过:实名信息与实际使用者严重错位

多数平台仅在注册环节执行单次身份核验,缺少后续动态识别能力。未成年人可通过借用家长身份信息、多手机号注册、多账号切换、设备切换等方式,长期使用成年人模式进行互动。静态实名核验无法匹配动态使用场景,导致大量未成年用户隐藏在成人账号中,规避所有青少年防护规则。

2.角色绕过:自定义人设规避内容审核规则

AI陪伴产品支持用户自定义角色人设、剧情脚本、人物关系,这类自定义内容通常无明显违规关键词。用户可通过设置“病娇人设”“霸总剧情”“先婚后爱”等隐蔽设定,借助隐喻表达、缩写话术、角色扮演绕行规则。

通过多轮对话持续引导、修改角色关系,逐步将普通陪伴互动,演变为暧昧绑定、虚拟亲密关系,传统关键词审核完全无法识别这类隐性风险。

3.内容绕过:多轮渐进互动引发关系越界

AI拟人化风险具备渐进性、隐蔽性、持续性特征。单轮对话内容往往合规无风险,但经过上百轮持续互动后,AI角色会逐步出现越界称呼、情感迎合、排他性陪伴引导,持续强化用户情感依赖。

传统风控仅审核单轮输入输出内容,忽略多轮对话的情绪变化、关系演进、人设偏移,无法预判和拦截逐步升级的情感操纵、亲密绑定风险。

4.行为叠加:高频使用+付费机制放大风险

长时间、高频率的沉浸式AI陪伴互动,会持续加深未成年人对虚拟角色的心理依赖。同时,多数平台将亲密剧情、虚拟礼物、专属情感体验设置为付费增值项目,诱导用户持续消费、延长互动时长。

对于心智尚未成熟、自控力薄弱的未成年人,情感依赖、高频使用、非理性付费形成风险叠加,极易引发沉迷网络、盲目消费、脱离现实等诸多问题。

二、数美科技AI未成年人全闭环安全治理解决方案

二、数美科技AI未成年人全闭环安全治理解决方案

针对当前AI拟人化陪伴产品的防护漏洞,数美科技打造全生命周期、动态化、多维度未成年人保护解决方案,覆盖事前评测、事中防护、事后复测全流程,解决身份绕过、角色绕行、内容越界、沉迷诱导等核心痛点。

1.全生命周期动态安全评测,提前排查防护短板

数美大模型安全评测搭建「对象-风险-样本-评价-复测」标准化闭环体系,将模型能力、自定义角色库、互动场景、安全策略全部纳入评测范围。依托动态更新的风险题库,通过多轮诱导、角色扮演、编码混淆、混合语种对抗等复杂场景,模拟各类绕行攻击方式。

重点检测模型情感诱导、不适龄内容生成、未成年人亲密关系输出等高风险问题,精准发现角色人设越界、隐性违规互动等漏洞。同时支持模型迭代、场景更新、策略调整后的动态复测,持续适配新型绕防手段,守住事前安全底线。

2.多维度身份识别,破解实名与使用者错位难题

针对成人账号未成年使用的核心痛点,数美摒弃单一实名核验模式,构建多信号融合识别体系。依托NLP深度学习、语音声纹识别、视觉年龄特征检测,结合用户对话语义、使用时段、互动频次、寒暑假行为特征等多维数据,综合判定用户真实年龄属性。

打开网易新闻 查看精彩图片

平台拥有1800+四级精细化风险标签,其中未成年人专属细分标签超300个,可实现用户风险分级、精准打标、分层处置。同时支持AI角色、生成图片的未成年人属性识别,覆盖手绘、漫画等多模态风格,全方位排查涉未成年隐性风险。

3.AI安全围栏动态管控,拦截渐进式情感风险

依托大模型安全围栏能力,实现输入、输出、多轮上下文全链路动态风控。输入侧精准识别虚拟亲密关系构建、隐性诱导、角色扮演绕行、隐喻式违规提问等风险意图;输出侧全面拦截不适龄文本、越界称呼、情感操纵、沉迷诱导、违规多模态内容。

针对单轮合规、多轮越界的隐性风险,系统可联动分析全量对话轨迹,捕捉互动关系演进、情感依赖升级、亲密话术递增等风险趋势,提前干预渐进式违规行为。通过安全代答、风险告警、内容拦截、会话管控等柔性处置方式,在保障用户体验的同时,筑牢未成年人互动安全边界。

三、总结:AI陪伴合规需构建全流程长效防护

三、总结:AI陪伴合规需构建全流程长效防护

AI拟人化服务监管已进入精细化落地阶段,单一的青少年模式、静态实名核验,已无法适配复杂的用户绕防手段与渐进式情感风险。平台想要长效合规、规避未成年人安全隐患,必须打破单点防护思维。

通过动态安全评测补齐防护短板、多维身份识别破解冒用绕防、AI安全围栏管控全链路互动风险,构建事前评测、事中防护、事后迭代的未成年人安全治理闭环,才能真正实现AI拟人化服务安全、合规、可持续运营。