一个孩子点开“早教动画”,看到的却是被 AI 魔改后的暴力剧情;

一次看似普通的“暑期陪玩”,背后可能是诱导未成年人发送私密照片的陷阱;

一场盲盒直播里,“限量”“绝版”“手慢无”的话术,正在刺激未成年人冲动消费;

一块儿童智能手表,也可能因为语音问答、第三方 App 或输入法环节,成为不适龄内容触达未成年人的入口。

这些风险,已经不再只是某一条违规内容、某一个违规账号的问题。

在 AI 生成内容、算法推荐、虚拟陪伴、智能终端快速普及的今天,未成年人接触网络风险的路径变得更隐蔽、更连续,也更难被传统内容审核机制完全覆盖。

近期,中央网信办部署启动为期4个月的“清朗·未成年人网络保护”专项行动,围绕暑期未成年人网络环境整治、侵扰未成年人身心健康网络信息治理两个阶段,集中整治网上涉未成年人乱象问题,进一步压实网站平台主体责任。

地方层面的治理动作也在持续推进。近日,上海市网信办对属地音视频、网络文学、网络游戏、网络社交、电商以及 AI 平台等重点平台开展巡查抽检,并依法集中约谈问题较为突出的平台。相关通报中提到的低俗内容推荐、重要环节呈现不良信息、未成年人模式落实不到位等问题,也与本次专项行动所关注的重点高度一致。

对于平台而言,是否具备识别未成年人、识别风险信息以及控制风险传播的能力,将成为合规运营的重要前提。

01 三类重点环节,风险治理进一步前移

从整治要求来看,本次专项行动首先聚焦发布、互动、营销三个关键环节。

在发布环节,监管重点指向“毒动画”、AI 恶搞经典动画、危险挑战、不良 AI 角色等内容。这类风险通常借助动画、短剧、二创、AI 生成等形式包装,利用未成年人对熟悉 IP、猎奇剧情和互动玩法的兴趣,降低其风险识别能力。

在互动环节,风险更多隐藏在社交关系中。例如以“找闺蜜”“暑期陪玩”“二次元福利”为幌子,诱导未成年人发送私密照片、参与软色情陪聊,或在评论区、群组、私信中传播性暗示表情包、黑话烂梗、违法链接和网络欺凌内容。

这类风险的复杂之处在于,单条消息可能并不明显违规,但结合用户身份、上下文、多轮对话和互动关系后,风险才逐渐显现。

在营销环节,专项行动重点整治诱导未成年人拍摄不当照片、购买盲盒抽卡、接触电子烟、购买软色情装扮、学习 AI 换脸破解人脸识别、被虚假预售诈骗等问题。这意味着平台不仅要治理内容,还要关注商品、交易、支付、引流和身份核验机制是否被绕过。

第二阶段则进一步指向平台机制本身。

专项行动明确要求规范平台推荐行为,避免算法放大不良内容、诱导沉迷和过度消费,不得利用“附近的人”“可能感兴趣的人”等功能诱导未成年人不良交友。

同时,学习教育板块也被纳入重点治理范围。平台需要对经典儿童动画、启蒙早教、学习分享等内容采取更严格审核标准,防止不良内容借教育标签传播,也要限制账号过度发布未成年人出镜内容,避免 MCN 机构包装炒作“网红儿童”。

未成年人模式建设同样成为监管重点。

当前治理已经从“有没有青少年模式”,进入“青少年模式是否真实有效”的阶段。进入、退出核验是否可靠,模式内是否仍存在打赏、投票、诱导充值、不良内容,儿童智能手表、学习平板、应用商店专区是否存在违规 App,都会成为平台需要持续排查的问题。

02 从内容治理到全链路治理,平台面临哪些挑战?

AI 生成内容带来的生产侧风险

AIGC降低了内容生产门槛,也让违规内容更容易批量化、变体化和隐蔽化。AI 魔改动画、AI 短剧、AI 换脸、AI 虚拟角色等内容形态,使传统关键词和单点审核机制面临更大压力。平台不仅要判断内容是否违规,还要识别它是否为AI 生成、是否恶搞儿童熟悉IP、是否包含暴力恐怖、低俗暗示或不良价值导向。

互动关系中的隐性侵害风险

未成年人保护的难点,不只在于拦截违法内容,更在于识别“诱导过程”。例如诱导私密照片、诱导站外联系、软色情陪聊、网络欺凌、代骂围攻等风险,往往发生在私信、群聊、评论区、语音互动等场景中。平台需要具备跨内容形态、跨轮次、跨关系链的风险判断能力。

算法推荐和产品机制风险

未成年人接触内容的路径,很大程度上受推荐机制影响。如果平台算法持续推荐猎奇、低俗、暴力、争议儿童人设、软色情装扮或情绪极端内容,就可能放大风险影响。与此同时,打赏、抽卡、盲盒、投票打榜、附近的人、兴趣匹配等功能,也可能在特定场景下成为诱导沉迷、过度消费或不良交友的入口。

智能终端和 AI 陪伴产品带来的新边界问题

儿童智能手表、学习平板、AI 玩具、AI 陪伴应用等产品,正在进入未成年人日常生活。它们不仅承载内容展示,还涉及语音问答、摄像录音、聊天互动、第三方 App 接入和端侧推理。若缺乏有效防护,可能出现不适龄内容输出、隐私泄露、陌生人诱导、情绪操控、充值消费等风险。

这意味着,平台需要从单一内容审核,升级为覆盖身份识别、内容安全、互动治理、推荐约束、消费保护、AI 安全、终端防护和应急处置的综合治理体系。

03 面向未成年人网络保护,易盾如何支撑平台合规治理?

围绕本次专项行动提出的治理要求,网易智企旗下易盾业务将未成年人保护拆解为**“身份识别、内容治理与技术约束”**三个核心层面,形成贯穿内容、场景与技术应用的整体能力体系。

未成年人身份识别,夯实分级保护基础

未成年人保护的前提,是平台能够准确识别用户身份和风险状态。

易盾可通过实名认证人脸核身等能力,辅助平台完成用户入网身份核验。在此基础上,结合年龄识别模型、声纹特征、用户资料、聊天语音、动态跟帖、私信内容、在线时长、登录时段等多维信号,对未实名或身份存疑账号进行未成年人嫌疑度判断。

当系统识别到高风险账号或疑似未成年人用户时,平台可进一步触发内容限制、功能限制、消费限制、二次核验、青少年模式引导等保护措施,实现更精细的分级治理。

多模态内容治理,覆盖风险识别与行为干预

本次专项行动点名的很多问题,并不是传统意义上“一眼可见”的违法内容,而是更隐蔽、更场景化的未成年人风险。

例如,AI 魔改动画可能借“儿童动画”“早教启蒙”标签传播暴力恐怖内容;“找闺蜜”“暑期陪玩”等话术可能成为诱导未成年人发送私密照片的入口;盲盒抽卡、直播拆卡、软色情装扮等内容,也可能通过营销包装降低未成年人的风险识别能力。

针对这些场景,易盾可依托文本、图像、音频、视频等多模态内容风控模型,识别诱导危险行为、价值观偏差表达、隐私信息暴露、诱导消费等风险,覆盖短视频、直播、评论、私信版块、智能终端语音问答等业务形态。

同时,未成年人风险往往并非由单条内容触发,而是由互动关系与行为路径逐步形成。对此,易盾可结合互动频率、行为路径、消费模式、账号风险等信号,在风险形成阶段进行识别和干预。例如,对疑似诱导私密照片、软色情陪聊、直播诱导打赏、盲盒过度消费、群组围攻代骂等行为进行预警、拦截或转人工复核。

通过风险标签体系和分级处置机制,平台可以更准确地区分正常表达、剧情演绎、科普提醒和违规诱导,使未成年人保护从“内容处置”进一步延伸到“行为治理”。

技术应用约束,延伸算法推荐与终端防护

随着算法推荐、生成式AI和智能终端成为未成年人接触网络内容的重要入口,保护能力也需要进一步嵌入技术运行机制之中。

在推荐场景中,易盾可结合未成年人身份识别结果和内容风险标签,辅助平台建立差异化推荐策略,降低暴力、低俗、猎奇等内容进入未成年人信息流的概率。对于“附近的人”“兴趣匹配”等社交推荐功能,也可加强异常触达、诱导站外联系、陌生人搭讪等风险识别,减少未成年人遭遇不良社交的可能。

在AI 互动场景中,易盾可通过高风险提示词过滤、生成结果校验、多轮上下文识别等能力,避免模型输出不适宜未成年人接触的内容。

对于 AI 陪伴、AI 角色、教育大模型、儿童智能硬件等产品,易盾大模型安全围栏CMA 审核智能体等能力可作为底层支撑,帮助平台识别越狱诱导、角色扮演规避、隐性低俗表达、错误价值观输出等风险,让AI 互动始终运行在安全边界内。

在终端场景中,面向儿童智能手表、学习平板、AI 玩具、智能穿戴等设备,易盾可支持端侧本地检测与云端安全策略协同,在弱网或离线环境下完成基础内容识别和风险阻断,并通过云端策略更新、风险样本迭代和日志追溯,持续治理语音问答、输入法、第三方 App、互动聊天、诱导充值等风险。

同时,平台还可根据识别结果触发功能限制、使用时长控制、消费保护、互动能力调整等分级保护措施,避免未成年人模式“形式上线、保护失效”,让不同使用场景下的未成年人获得更具针对性的保护。

此次“清朗·未成年人网络保护”专项行动的启动,意味着未成年人网络保护正在进入更加精细、系统和常态化的治理阶段。

对于平台而言,合规重点已经不只是“把违规内容删掉”,而是要真正看清风险如何产生、如何传播、如何被推荐、如何在互动和消费中放大,并在产品设计和运营机制中提前建立防线。

易盾将持续以 AI 驱动的内容安全、业务安全和大模型安全能力,帮助平台完善未成年人保护体系,在守住合规底线的同时,为未成年人营造更加健康、安全、适龄的网络环境

Logo

网易易盾是国内领先的数字内容风控服务商,依托网易二十余年的先进技术和一线实践经验沉淀,为客户提供专业可靠的安全服务,涵盖内容安全、业务安全、应用安全、安全专家服务四大领域,全方位保障客户业务合规、稳健和安全运营。

更多推荐