-
网易智企重磅发布《AI安全白皮书》,让AI看得见、管得住、测得出、追得回
发布于: 2026-08-07网易智企携手金山办公、Minimax正式发布《AI安全白皮书》,提出五层风险框架与五维半定量评估体系,面向智能体时代给出AI安全治理的落地路径。
-
易盾如何帮助AI陪伴产品满足新规要求?
发布于: 2026-08-06易盾从大模型安全围栏、CMA审核智能体、未成年人保护、安全评估与备案支撑四方面,帮助AI陪伴产品建立覆盖模型、产品、运营和处置的全链路治理能力。
-
AI陪伴产品极端情境怎么处置?识别、安抚与干预流程拆解
发布于: 2026-08-06用户表达极端情绪或出现风险信号时,AI陪伴产品应从陪聊模式切换为安全处置模式,通过识别、安抚、干预三层机制完成规范处置,落实新规对极端情境应急处置的合规要求。
-
新规落地后,拟人化互动服务如何建立安全合规体系?
发布于: 2026-08-04随着《人工智能拟人化互动服务管理暂行办法》(以下简称《办法》)的落地实施,拟人化互动服务的合规议题,正在从“如何理解新规”进入“如何完成自评估、如何把要求落到产品和运营流程里”的阶段。
-
再获认可!网易智企大模型安全围栏能力通过行业验证
发布于: 2026-08-03近日,由中国人工智能产业发展联盟(AIIA)安全治理委员会主办的"智守安全·内容求真"2026AIIA安全治理专题会在北京召开,围绕生成式人工智能、AI生成内容、深度合成与智能体应用带来的安全治理挑战
-
AI数字员工进入企业,安全边界怎么设?从权限、工具到审计的三层防护
发布于: 2026-07-28当AI从"帮人写一段话"变成能调用系统、执行任务的数字员工,安全边界怎么设?从"把AI当成新员工管理"的比喻出发,拆解权限最小化、工具白名单、意图校验三层防护机制。
-
内容下架、模型输出争议,企业AI安全证据链怎么建立?
发布于: 2026-07-28从HuggingFace安全取证被AI护栏误拦的真实案例切入,拆解企业AI安全证据链的四个关键环节——身份认证、场景判定、行为记录、合规审计,说清为什么AI安全不只是"拦住风险",更要"说得清为什么拦
-
企业AI安全方案怎么选?效果、服务、可靠三个评估维度
发布于: 2026-07-28企业选AI安全方案不能只看参数和报价。本文从效果、服务、可靠三个维度拆解选型标准,帮助企业在AI安全方案评估中做出可靠决策。
-
AI对抗AI时代,内容安全为什么必须从规则引擎升级到安全大模型?
发布于: 2026-07-28黑灰产已全面AI化,传统规则引擎在语义理解、变体识别和对抗进化面前节节败退。本文从规则引擎的五大天花板出发,拆解安全大模型如何实现从关键词匹配到语义理解的质变,并通过对比数据和实战场景说明:升级不是选
-
黑灰产用AI批量生成攻击素材,内容平台怎么用AI对抗AI?
发布于: 2026-07-28黑灰产利用AI工具批量生成违规图片、变体文本和对抗样本,传统审核手段的漏检率正在飙升。本文以违规图片检测链路为切入口,拆解AI攻击手法与AI防守方案的对弈全景,用检测链路对比案例展示:为什么必须用AI