9月17日消息,国家网络安全宣传周期间,百度智能云司南AI审核在CCS成都网络安全技术交流活动上正式发布专家版审核智能体,面向AIGC时代多模态组合违规、语义变体、复杂场景判断等传统机审难以覆盖的难题,依托大模型打通内容深度判定全链路,推动内容审核从能审跨越至懂审。
在整治AI应用乱象行动中,AI生成的虚假信息、低俗内容成为治理重pg电子点,平台不仅要审AI,还要提升对违规内容新型变体的识别处置能力。这背后是一道新命题:如今的违规内容越来越会伪装——换个表述、改个场景、拼几张图,单看合规,组合起来风险才显现。当黑灰产也开始用AI批量生产更隐蔽的违规内容,用来审核的AI还看得懂吗?
过去十来年,我们做的是能审——能不能把违规内容拦下来;大模型时代,得往前再走一步,做懂审,差距就差在这个懂字上。发布现场,司南团队AI安全审核解决方案专家夏可征表示。
作为一款大模型驱动的全模态内容风控产品,司南已覆盖图文、音视频、直播、文档、网页等多种内容类型。专家版审核智能体进一步引入多模态联合分析与意图级语义推理能力,把复杂内容的判定链路真正串起来,形成信息看全、意图读懂、标准判准、依据说清的完整能力链:AI多模态语义分析,联合理解图、文、音、视频信息,识别单看合规、组合后违规的风险;AI意图理解,穿透谐音、拆字、隐语等表述变体,判断内容真正想表达什么;AI图像综合要素识别,综合场景、着装、姿态、构图与意图,判断复杂主观的图像内容;AI人审辅助,定位具体违规点,输出审核标签、违规理由和判定依据,让判断可复核、可追溯;定制专属审核智能体,由策略专家1v1配置,让审核能力贴合平台业务。

能力升级带来的是可量化的效果。某社交业务接入专家版审核智能体后,黑产变体召回率提升4—5倍,针对复杂主观内容的审核需求,专家版判定精度达95%+;在某直播业务中,接入专家版后仅3%内容触发人工复核,综合判定准确率达99%,在审核资源不增加的情况下,额外承接了约50%的业务增量。
目前,百度智能云司南AI审核专家版审核智能体已覆盖社交内容社区、直播交友、品牌电商等场景的实时审核,并支持对历史内容的批量回扫。司南正以深层次的语义理解力,为企业筑牢AIGC时代可解释、可持续的内容安全防线。
