以技术升级应对新型AI社交风险,Soul张璐团队26年Q2生态安全治理展现成效

来源:互联网 时间:2026-08-19

当生成式AI技术应用到各领域过程中,黑灰产违规手段呈现隐蔽化、链路化且快速迭代的特征,传统“事后处置”审核模式逐渐难以适配治理需求。作为负责任创新的代表平台之一,Soul张璐团队为何持续推动AI风控环节前移?近日Soul App发布《2026年第二季度生态安全报告》,给出最新实践成果:依托全链路AI研判体系,将风险拦截关口前置,从源头压缩违规行为生存空间,平衡技术创新与用户真实社交体验。

AI治理模式迭代升级,全链路切断黑灰产路径

当前黑灰产在互联网平台已摆脱单一关键词违规模式,具体表现为批量注册虚假账号、杀猪盘诈骗、盗用肖像打造假人设、私聊定向骚扰、诱导线下消费等行为。违规账号可批量变换文案、图片规避静态审核,待不良内容完成传播、用户遭受权益损害后,平台再介入处置,不仅维权成本高,也极易破坏社区生态环境。

传统审核仅聚焦单条内容文本,无法联动账号注册行为、长期互动轨迹、设备信息综合研判,存在识别滞后、漏判率高等痛点。报告数据显示,早期仅依靠后置拦截策略时,黑灰产内容拦截效率仅30%,违规账号能够长期活跃于社区广场、私聊、群聊等多元场景,持续干扰正常用户交流。

在此背景下,Soul张璐团队治理逻辑选择从 “违规出现再清理” 转向 “风险萌芽即拦截”,是为了营造更好的AI社交环境。依托AI打通账号、内容、互动全维度数据,在内容发布、账号匹配、私聊发起等环节完成前置风险识别,从源头切断黑灰产传播路径。

全链路AI能力落地,前置风控实现治理效能翻倍

Soul张璐团队将Agent分层部署社区全流程,覆盖注册、发帖、互动、私聊等板块,实现风险治理全面前移,多项核心治理收获成效。

(一)反诈Agent前置识别,精准拦截杀猪盘

针对诈骗账号伪装普通用户私聊诱导的隐蔽特征,平台升级反诈Agent,摒弃传统关键词筛查,融合账号基础特征、长期互动行为、对话语义开展综合判定,实现反诈识别准确率超 93%。 前置识别机制可在高风险账号主动发起私聊前完成标记拦截,使至26年二季度批量黑灰产内容处置率从以往的30%提升至60%,大幅缩短违规账号在平台的存活周期,从源头降低诈骗概率。风控治理核心数据

(二)假人设前置筛查,遏制盗图虚构身份传播

盗用他人肖像、搬运网络素材搭建虚假人设是黑灰产引流、诈骗的基础手段。Soul张璐团队将人像识别、图片溯源AI部署于发帖前置环节,用户发布图片内容时同步完成核验。2026 年第二季度,平台前置识别并处置假人设违规账号3万余个,拦截虚假人设相关帖子8万余条,避免虚假身份内容流入公开广场。

(三)多场景前置过滤,降低违规触达

面向广场、群聊、私聊三大核心社交场景,平台上线分层前置拦截策略:内容发布阶段机审直接拦截低俗、引流、辱骂类违规内容400万条;针对女性用户优化私聊前置保护机制,系统提前隔离骚扰信息,26年二季度日均隔绝网暴、恶意骚扰超3099次;针对诱导消费的“消费托”账号开展专项前置识别,累计处置风险账号3.2万个。

风控前移配套多维体系,实现技术、保护双协同

AI 风控前移并非单一技术升级,平台同步配套用户引导、未成年人前置保护机制,构建完整前置治理闭环。在用户引导层面,Soul张璐团队官方账号“风纪球长”常态化公示违规典型案例,26年二季度安全科普内容累计触达47万用户,帮助用户建立风险辨别意识; 在未成年人保护领域,新增了针对未成年人发帖内容的AI审核能力。系统在内容发布环节辅助判断账号是否可能属于未成年人,并结合未成年人安全标准识别相关风险,提升平台主动发现问题的效率。截止目前,平台主动识别未成年人账号比例突破99%,在内容发布源头筛查不适宜青少年的风险信息,将未成年人防护关口全面前置。同时,平台日常向用户推送文明沟通提示,从行为引导层面减少攻击性、骚扰类内容产生,从源头缓解治理压力。

AI风险治理前移,本质是AI社交治理应对技术变革的主动升级。面对持续迭代的网络黑灰产与AI衍生的新型风险,后置清理模式难以长久守护社区生态。Soul张璐团队以AI技术为核心抓手,打通全场景前置识别链路,搭配用户科普、未成年人前置防护体系,形成 “提前识别、源头拦截、柔性引导”的治理路径。通过持续推进风险治理前移,不断压缩违规行为生存空间,为AI社交安全治理贡献可参考样本!

相关文章

标签:

A5创业网 版权所有