随着人工智能逐步应用于互联网平台治理工作,AI成为提升内容识别效率、风险研判能力与生态治理精细化水平的重要力量。当下互联网平台风险形态不断演化,黑灰产作弊、虚假人设、诱导消费、私聊骚扰等问题隐蔽性增强,且呈现链路化特点,对平台治理的及时性、准确性、系统性提出更高要求。在此背景下,Soul App对外发布《2026年第二季度生态报告》,报告展现平台借助AI技术,覆盖反诈、违规内容处置、私聊群聊治理、未成年人保护等多个板块,推动风险识别从单一内容审核,转向账号、行为、社交链路的综合研判。

针对黑灰产账号批量注册、快速发布内容、频繁变换内容的特征,Soul App在原有审核基础上强化批量作弊行为识别,把大量风险内容拦截在社区传播之前。经过迭代优化,相关策略的风险内容处置率由上线初期的约30%提升至60%,有效压缩黑灰产账号在平台的存活周期。在诈骗风险管控层面,平台升级“杀猪盘”相关账号与行为识别手段,跳出传统固定关键词审核模式,综合账号特征、互动行为、内容语义开展判断。目前,相关Agent能力准确率已达到93%以上,为高风险账号前置识别提供技术支撑。平台同时打击盗用图片、虚构身份、批量搬运人设内容等行为,二季度,Soul累计处置假人设违规账号3万余个,识别并处理相关帖子8万余条,降低虚假身份内容干扰正常社交。

广场、群聊、私聊是平台主要互动阵地,Soul App围绕这些场景完善治理手段,重点整治低俗擦边、有偿交友、攻击辱骂、违规引流等各类违规内容。报告显示,平台二季度通过机审直接拦截违规内容400万条,处置相关跟帖评论726万条,累计拉黑违规设备3723个。与此同时,平台日均向2533名用户进行社区规范和文明表达提醒。平台结合识别审核、流量限制多重手段处置低俗、攻击性、引流类低质信息,日均处理相关低质内容超过13万条;针对“消费托”带来的虚假邀约、诱导线下消费风险,Soul App上线专项自动化治理策略,累计处置相关风险账号约3.2万个,减少用户遭遇诱导消费的情况。

私聊场景的骚扰行为具备较强隐蔽性,容易持续伤害用户体验,Soul App二季度升级女性用户私聊保护机制,依托消息内容、互动频率、账号行为识别疑似骚扰信息,完成风险隔离,阻止低质信息直接触达用户。对于反复骚扰女性用户的账号,平台依靠多场景联动策略限制其触达范围,兼顾正常沟通体验与骚扰风险防控。二季度,Soul日均帮助用户隔绝网暴和频繁骚扰3099次,日均处置存在私聊不文明行为的用户1737个,并通过产品提示日均引导用户文明发言19.9万次。
在运用AI开展治理的同时,Soul App搭建AI生成内容识别提示体系,针对AI人像、虚假生活场景、疑似盗图内容,依托图片元数据、外显标识、图像人像特征分层识别,命中后输出中性提示告知用户内容属性。识别工作在后台运行,不干扰用户发帖与内容展示,重在提升用户对内容来源的知晓度。同时,平台还兼顾用户教育,官方账号“风纪球长”发布科普、典型处罚案例,开展网络辟谣与社交礼仪宣导,二季度累计触达用户47万人。未成年人保护方面,平台新增未成年人发帖AI审核能力,目前,平台主动识别未成年人的比例已超过99%,推动未成年人保护向事前防范转变。
未来,Soul App将持续融合AI、人工审核、产品机制与用户教育,不断完善全流程治理体系,守护有序的社交环境。