中文站

易盾动态

新一代数字内容风控领军者

动态资讯>AI内容审核
  1. 清朗专项行动升级,平台如何应对未成年人网络保护新要求?

    发布于: 2026-08-14

    中央网信办部署启动为期4个月的“清朗·未成年人网络保护”专项行动,集中整治涉未成年人乱象,压实网站平台主体责任。易盾将未成年人保护拆解为身份识别、内容治理与技术约束三个核心层面。

  2. 审核之外,还有件更耗人的事:内容质量标注

    发布于: 2026-08-11

    内容质量标注在部分客户场景中人力投入甚至高于安全审核。CMA借助大模型理解自然语言标准,把业务标准转化为内容类别与质量等级标签,覆盖图文分类、视频分级、联合达标等场景,为平台内容管理提供结构化依据。

  3. 网易智企重磅发布《AI安全白皮书》,让AI看得见、管得住、测得出、追得回

    发布于: 2026-08-07

    网易智企携手金山办公、Minimax正式发布《AI安全白皮书》,提出五层风险框架与五维半定量评估体系,面向智能体时代给出AI安全治理的落地路径。

  4. 易盾如何帮助AI陪伴产品满足新规要求?

    发布于: 2026-08-06

    易盾从大模型安全围栏、CMA审核智能体、未成年人保护、安全评估与备案支撑四方面,帮助AI陪伴产品建立覆盖模型、产品、运营和处置的全链路治理能力。

  5. AI陪伴产品极端情境怎么处置?识别、安抚与干预流程拆解

    发布于: 2026-08-06

    用户表达极端情绪或出现风险信号时,AI陪伴产品应从陪聊模式切换为安全处置模式,通过识别、安抚、干预三层机制完成规范处置,落实新规对极端情境应急处置的合规要求。

  6. 新规落地后,拟人化互动服务如何建立安全合规体系?

    发布于: 2026-08-04

    随着《人工智能拟人化互动服务管理暂行办法》(以下简称《办法》)的落地实施,拟人化互动服务的合规议题,正在从“如何理解新规”进入“如何完成自评估、如何把要求落到产品和运营流程里”的阶段。

  7. 再获认可!网易智企大模型安全围栏能力通过行业验证

    发布于: 2026-08-03

    近日,由中国人工智能产业发展联盟(AIIA)安全治理委员会主办的"智守安全·内容求真"2026AIIA安全治理专题会在北京召开,围绕生成式人工智能、AI生成内容、深度合成与智能体应用带来的安全治理挑战

  8. AI数字员工进入企业,安全边界怎么设?从权限、工具到审计的三层防护

    发布于: 2026-07-28

    当AI从"帮人写一段话"变成能调用系统、执行任务的数字员工,安全边界怎么设?从"把AI当成新员工管理"的比喻出发,拆解权限最小化、工具白名单、意图校验三层防护机制。

  9. 内容下架、模型输出争议,企业AI安全证据链怎么建立?

    发布于: 2026-07-28

    从HuggingFace安全取证被AI护栏误拦的真实案例切入,拆解企业AI安全证据链的四个关键环节——身份认证、场景判定、行为记录、合规审计,说清为什么AI安全不只是"拦住风险",更要"说得清为什么拦

  10. 企业AI安全方案怎么选?效果、服务、可靠三个评估维度

    发布于: 2026-07-28

    企业选AI安全方案不能只看参数和报价。本文从效果、服务、可靠三个维度拆解选型标准,帮助企业在AI安全方案评估中做出可靠决策。