桃子桃子快讯
返回首页
行业动态

AI内容风控进入「以模治模」时代

艾瑞咨询报告指出,AI内容风控正从人工与规则审核迈向大模型治理,第三方市场规模预计从2023年11.8亿元增至2030年…

2026.08.14 · 周五5 分钟阅读

AI在放大内容风险的同时,也成了治理这些风险的唯一可行工具,行业正从人力审核跨入「以模治模」的大模型治理时代。艾瑞咨询最新报告显示,国内AI应用用户渗透率一年多内从19.4%升至54.7%,2025年全国数据生产总量达52.26泽字节、同比增长27.3%,AIGC内容爆发让传统人工与规则审核的效率和覆盖能力彻底见顶。

风险与监管同步收紧

内容风控的紧迫性来自两股同时收紧的力量。

一是风险本身的失控。AI洗稿、虚假视频、伪造新闻批量涌现;AI换脸、拟声被用于冒充亲友精准诈骗;克隆公众人物形象与声音进行虚假代言、恶意抹黑;更极端情形下,大模型还输出犯罪指导、诱导未成年人自杀。同一项技术,一端在制造前所未有的内容风险,另一端也在成为治理这些风险的核心工具。

二是监管的刚性化。2025年全国网信系统约谈网站平台5811家、警告1646次、对521家实施罚款,下架App 2133款、注销关闭网站及App 9637家。《人工智能生成合成内容标识办法》要求AI内容强制标识,构建显式与隐式的双重标识体系;2026年4月,网信办启动「清朗·整治AI应用乱象」专项行动,监管由运动式转向常态化。平台被明确为信息内容管理的第一责任人,合规已成生存底线。

从关键词到「大模型治理」的四阶段演进

内容风控走过四个阶段:纯人工审核时代、关键词加规则引擎时代(2009-2015年)、小模型初审加人工复核时代(2016-2022年),以及2023年以来以大模型为核心的治理时代。前三个阶段的共同瓶颈是效率与内容量级不匹配、标准易被绕过、缺乏推理能力,隐喻表达类违规内容识别不了。

大模型治理时代的关键变化,是审核系统具备了理解深层意图的推理能力,并把治理从事后审核推向全链路主动治理。这一阶段分为两条战线:

  • 互联网平台侧:以大模型重构审核体系,实现深层意图理解、多模态协同分析与全链路闭环。
  • AI大模型自身侧:从训练数据合规清洗,到输入输出防护,再到AI对话、绘画、视频的全场景治理。

之所以必须以模治模,原因是攻击也在同步升级:AIGC让风险内容生产成本极低、可规模化;藏头诗、变体、特殊符号代指等隐喻对抗规避关键词;针对大模型,还出现提示词注入与越狱、数据投毒致输出偏见、算力耗尽攻击、逆向攻击窃取训练数据,乃至Agent被诱导的越权行为。

漏斗式分级与内外兼修的新一代体系

新一代体系的核心目标是以最低成本完成识别。互联网平台侧采用漏斗式分级过滤:内容先经关键词与规则引擎轻量拦截明显违规,中风险内容交由轻量模型加多模态分流,只有少数复杂内容才进入大模型深度分析与人工专家判定。成本梯度设计的核心,是用最小算力挡住大多数明显违规,把昂贵的深度推理留给真正需要的那一小部分内容。

AI大模型自身侧则强调内外兼修:

  • 内生安全:把安全能力融入知识库等模型底层架构,从源头做训练数据清洗、价值观对齐与定向解毒。
  • 外部围栏:在输入、模型、输出三侧构建动态防护,包括输入侧提示词安全审查与对抗样本检测,输出侧流式实时检测、幻觉检测与多模态融合检测,并以安全运营中心支撑全链路反馈与主动进化。

一个高速增长、被低估的市场

内容风控正成长为一个独立市场。基于大模型技术的第三方内容风控市场规模,预计从2023年的11.8亿元增长到2030年的93.7亿元,年复合增长率超30%。增长由两股力量驱动:

  • 存量替代:当前依赖人工与传统规则机审的传统审核仍占超50%份额,正被新一代智能风控逐步取代。
  • 增量创造:短视频、直播实时流、AIGC内容体量指数级增长,新兴交互场景不断诞生,把风控边界持续推远。

供给侧已形成分层格局:长期深耕内容安全、沉淀海量风险样本的专业风控服务商;依托云平台提供开箱即用API的综合型云厂商;从网络安全业务外延的传统网安厂商。商业模式以SaaS部署加按量计费为核心,匹配AIGC场景高频、动态的调用需求。头部集中度已不低,领先服务商在第三方大模型内容风控市场约占43.7%份额。

从合规底线到安全基建

内容风控的定位正在发生根本转变:它不再只是防止损失的被动合规成本,而是数字经济的一项核心安全基建。当平台的价值重构从流量转向真实,内容安全本身就成为生产力。技术上,盾与矛的攻防将长期螺旋上升;对决策者而言,真正的问题不是要不要投入内容风控,而是把它当成一次性合规支出,还是支撑业务长期可信的基础设施来建设。

(本文综合艾瑞咨询公开发布的行业研究报告,数据与观点来自其原文分析。)

信源