首页 > 技术

信通院AI安全治理新标准发布,Soul张璐团队披露26年Q2生态安全治理成果

2026-08-19 18:58:09      西盟科技资讯   


  2026年8月11日,中国信息通信研究院对《人工智能 安全治理 系统风险管理能力要求》(YD/T 7173-2026)行业标准发布官方解读。该标准搭建标准化AI风险管理工具体系,通过风险评估方法表、风险识别清单、风险评估报告与应对报告,引导平台转变治理思路,推动AI安全管理从事后补救模式,全面转向前置主动防控,为社交、文娱等平台规范运用AI 技术提供清晰执行依据。

  伴随着全社会对AI治理和风险管控问题关注度的日益提升,各方需要积极参与贡献智慧与力量。Soul是一家专注于情绪感知与交互、模型与应用一体化的AI生态公司,在AI治理方面处在行业领先水平,近日Soul张璐团队发布《2026年第二季度生态安全报告》,全面展示平台依托AI技术实现风险治理前移的实践成果。

  搭建前置化AI风控体系,以“AI对抗AI”

  中国信息通信研究院本次发布的行业标准核心导向,是依托AI技术实现风险早识别、早拦截、早处置,减少黑灰产、网络诈骗带来的用户权益损害。而Soul张璐团队在此之前就开始尝试以AI治理AI、前置把控风向,此次发布的2026年第二季度生态安全报告,展现了最新升级的机制和成果。针对黑灰产批量注册、杀猪盘诈骗、虚假人设等隐蔽化、链路化风险,迭代AI审核Agent,构建全链路风险拦截机制。

  针对批量作弊账号,Soul张璐团队升级识别方式,打破传统审核仅拦截已发布内容的局限,实现风险账号、违规内容发布提前拦截。经过持续优化,黑灰产风险内容前置处置率从初期 30%提升至60%,大幅压缩违规账号在社区内的活动周期。在反诈核心场景,专属反诈 Agent融合账号基础特征、长期互动行为、文本语义多层维度综合研判,摆脱单一关键词识别的局限性,实现诈骗行为识别准确率突破93%,可在诈骗链路成型前锁定高风险账号,精准落地标准要求的前置风险研判。

  同时平台持续打击虚假人设行为,二季度累计处置盗用肖像、虚构身份的违规账号3万余个,清理搬运伪造人设相关帖子8万余条,从源头减少虚假信息干扰真实社交体验,落实AI技术对账号全生命周期的风险管控。

  多场景精细化治理 分层完善用户保护

  Soul张璐团队针对广场公开内容、群聊、私聊差异化场景搭建专属AI治理策略,兼顾社区内容质量与用户私密社交安全,实现公开、私密场景风险全覆盖。

  面向广场、群聊等公域场景,平台通过机器预审自动化拦截低俗擦边、有偿引流、恶意攻击类内容,二季度机审直接拦截违规内容400万条,处置违规评论726万条,拉黑涉违规设备3723个;针对诱导线下消费的“消费托”新型风险,上线专项自动化识别模型,累计处置相关风险账号3.2万个,降低用户遭遇诱导消费的隐患。另外,平台日均对超13万条低质内容完成识别限流,同步通过产品弹窗向2533名用户推送社区文明规范提示,以技术干预搭配正向引导净化生态。

  私聊场景风险具备强隐蔽性,也是本次重点覆盖的私密交互风险领域。Soul张璐团队针对性升级女性用户私聊保护机制,依托AI识别消息频次、发言语义、账号历史行为搭建风险隔离通道,对持续骚扰、反复跨链路侵扰用户的账号实施联动限制。二季度平台日均隔绝网暴、恶意骚扰近3099次,日均处置私聊不文明账号1737个,通过AI柔性干预,在不干扰正常连接的前提下,降低私密社交风险。

  私聊与AI图识别治理图

  筑牢未成年人防护屏障,技术+安全教育构建长效安全生态

  AI 安全治理不仅依靠技术工具,还同步强调分人群专项防护与常态化用户安全教育协同落地。Soul张璐团队持续加码未成年人专项保护,新增未成年人发帖AI预审能力,通过账号行为、内容特征主动判别未成年人账号,当前平台未成年人主动识别比例超99%,提前拦截不适宜未成年人浏览、发布的风险内容,推动未成年人安全防护从事后处置转向事前预判。

  在技术治理之外,平台打通用户教育渠道,官方安全账号“风纪球长” 持续公示违规典型案例、发布网络安全科普内容,围绕反诈、网络谩骂、虚假信息等主题开展社交礼仪宣导,二季度安全内容累计触达47万用户。以 AI 技术防控为基础,搭配规则公示、用户安全教育形成完整治理闭环,与行业标准的AI安全建设思路完美契合。

  结语

  中国信息通信研究院AI安全治理行业标准的落地,为全行业划定AI风控规范化发展路径。Soul张璐团队以2026年第二季度生态安全治理实践印证,AI技术只有深度前置嵌入账号、内容、交互全链路,才能高效应对持续迭代的网络黑灰产风险。作为行业前沿探索者,Soul张璐团队持续摸索更完善的治理机制建设,推动精细化安全治理能力不断提升,致力于构建一个安全、有序的AI社交空间。

相关阅读

    无相关信息