/朝聞通/2026年8月11日,中國信息通信研究院對《人工智能 安全治理 系統風險管理能力要求》(YD/T 7173-2026)行業标準發布官方解讀。該标準搭建标準化AI風險管理工具體系,通過風險評估方法表、風險識别清單、風險評估報告與應對報告,引導平台轉變治理思路,推動AI安全管理從事後補救模式,全面轉向前置主動防控,為社交、文娛等平台規範運用AI 技術提供清晰執行依據。
伴随着全社會對AI治理和風險管控問題關注度的日益提升,各方需要積極參與貢獻智慧與力量。Soul是一家專注于情緒感知與交互、模型與應用一體化的AI生态公司,在AI治理方面處在行業領先水平,近日Soul張璐團隊發布《2026年第二季度生态安全報告》,全面展示平台依托AI技術實現風險治理前移的實踐成果。
搭建前置化AI風控體系,以“AI對抗AI”
中國信息通信研究院本次發布的行業标準核心導向,是依托AI技術實現風險早識别、早攔截、早處置,減少黑灰産、網絡詐騙帶來的用戶權益損害。而Soul張璐團隊在此之前就開始嘗試以AI治理AI、前置把控風向,此次發布的2026年第二季度生态安全報告,展現了最新升級的機制和成果。針對黑灰産批量注冊、殺豬盤詐騙、虛假人設等隐蔽化、鍊路化風險,疊代AI審核Agent,構建全鍊路風險攔截機制。

針對批量作弊賬号,Soul張璐團隊升級識别方式,打破傳統審核僅攔截已發布内容的局限,實現風險賬号、違規内容發布提前攔截。經過持續優化,黑灰産風險内容前置處置率從初期 30%提升至60%,大幅壓縮違規賬号在社區内的活動周期。在反詐核心場景,專屬反詐 Agent融合賬号基礎特征、長期互動行為、文本語義多層維度綜合研判,擺脫單一關鍵詞識别的局限性,實現詐騙行為識别準确率突破93%,可在詐騙鍊路成型前鎖定高風險賬号,精準落地标準要求的前置風險研判。
同時平台持續打擊虛假人設行為,二季度累計處置盜用肖像、虛構身份的違規賬号3萬餘個,清理搬運僞造人設相關帖子8萬餘條,從源頭減少虛假信息幹擾真實社交體驗,落實AI技術對賬号全生命周期的風險管控。

多場景精細化治理 分層完善用戶保護
Soul張璐團隊針對廣場公開内容、群聊、私聊差異化場景搭建專屬AI治理策略,兼顧社區内容質量與用戶私密社交安全,實現公開、私密場景風險全覆蓋。
面向廣場、群聊等公域場景,平台通過機器預審自動化攔截低俗擦邊、有償引流、惡意攻擊類内容,二季度機審直接攔截違規内容400萬條,處置違規評論726萬條,拉黑涉違規設備3723個;針對誘導線下消費的“消費托”新型風險,上線專項自動化識别模型,累計處置相關風險賬号3.2萬個,降低用戶遭遇誘導消費的隐患。另外,平台日均對超13萬條低質内容完成識别限流,同步通過産品彈窗向2533名用戶推送社區文明規範提示,以技術幹預搭配正向引導淨化生态。
私聊場景風險具備強隐蔽性,也是本次重點覆蓋的私密交互風險領域。Soul張璐團隊針對性升級女性用戶私聊保護機制,依托AI識别消息頻次、發言語義、賬号曆史行為搭建風險隔離通道,對持續騷擾、反複跨鍊路侵擾用戶的賬号實施聯動限制。二季度平台日均隔絕網暴、惡意騷擾近3099次,日均處置私聊不文明賬号1737個,通過AI柔性幹預,在不幹擾正常連接的前提下,降低私密社交風險。
私聊與AI圖識别治理圖
築牢未成年人防護屏障,技術+安全教育構建長效安全生态
AI 安全治理不僅依靠技術工具,還同步強調分人群專項防護與常态化用戶安全教育協同落地。Soul張璐團隊持續加碼未成年人專項保護,新增未成年人發帖AI預審能力,通過賬号行為、内容特征主動判别未成年人賬号,當前平台未成年人主動識别比例超99%,提前攔截不适宜未成年人浏覽、發布的風險内容,推動未成年人安全防護從事後處置轉向事前預判。
在技術治理之外,平台打通用戶教育渠道,官方安全賬号“風紀球長” 持續公示違規典型案例、發布網絡安全科普内容,圍繞反詐、網絡謾罵、虛假信息等主題開展社交禮儀宣導,二季度安全内容累計觸達47萬用戶。以 AI 技術防控為基礎,搭配規則公示、用戶安全教育形成完整治理閉環,與行業标準的AI安全建設思路完美契合。
結語
中國信息通信研究院AI安全治理行業标準的落地,為全行業劃定AI風控規範化發展路徑。Soul張璐團隊以2026年第二季度生态安全治理實踐印證,AI技術隻有深度前置嵌入賬号、内容、交互全鍊路,才能高效應對持續疊代的網絡黑灰産風險。作為行業前沿探索者,Soul張璐團隊持續摸索更完善的治理機制建設,推動精細化安全治理能力不斷提升,緻力于構建一個安全、有序的AI社交空間。