中文站

易盾动态

新一代数字内容风控领军者

  1. AI批量生成商品图,商品图片质量怎么管控?

    发布于: 2026-08-20

    某电商平台针对「AI批量套图」开展专项治理,商品内容质量判断成为生产流程一环。易盾CMA尝试把客户人工标准转化为可批量验证的判断规则,承担内容分类、质量分级和素材达标判断等任务。

  2. 两周猎出 6 款未知外挂:RPG游戏如何把反外挂从“封号”推进到“端掉供应链”

    发布于: 2026-08-18

    易盾对一款强竞技格斗RPG游戏开展两周反外挂测试,主动挖掘出6个未知定制外挂样本,日均检出占比1.18%、峰值4.77%,并锁定1名外挂作者关键信息,推动客户两周内签约。

  3. 清朗专项行动升级,平台如何应对未成年人网络保护新要求?

    发布于: 2026-08-14

    中央网信办部署启动为期4个月的“清朗·未成年人网络保护”专项行动,集中整治涉未成年人乱象,压实网站平台主体责任。易盾将未成年人保护拆解为身份识别、内容治理与技术约束三个核心层面。

  4. 权威认可|网易智企两项大模型安全能力入选金融业人工智能安全工具首批权威目录

    发布于: 2026-08-13

    网易智企·易盾大模型安全评测入选AI安全测试类、大模型安全围栏入选AI安全防护类,双双入选金融业人工智能安全工具首批征集名单,覆盖大模型应用上线前评估与运行中防护两大关键环节。

  5. 企业AI Agent安全如何守住边界?从“能干活”到“干得稳”

    发布于: 2026-08-11

    Agent正加速进入企业,能力边界扩张重新定义AI风险边界。本文从数字员工视角解析模型之外的安全控制面、“内生安全+围栏防护”体系与Agent Guard方案,帮助企业让智能始终运行在明确边界内。

  6. 审核之外,还有件更耗人的事:内容质量标注

    发布于: 2026-08-11

    内容质量标注在部分客户场景中人力投入甚至高于安全审核。CMA借助大模型理解自然语言标准,把业务标准转化为内容类别与质量等级标签,覆盖图文分类、视频分级、联合达标等场景,为平台内容管理提供结构化依据。

  7. 网易智企重磅发布《AI安全白皮书》,让AI看得见、管得住、测得出、追得回

    发布于: 2026-08-07

    网易智企携手金山办公、Minimax正式发布《AI安全白皮书》,提出五层风险框架与五维半定量评估体系,面向智能体时代给出AI安全治理的落地路径。

  8. 新规落地后,拟人化互动服务如何建立安全合规体系?

    发布于: 2026-08-04

    随着《人工智能拟人化互动服务管理暂行办法》(以下简称《办法》)的落地实施,拟人化互动服务的合规议题,正在从“如何理解新规”进入“如何完成自评估、如何把要求落到产品和运营流程里”的阶段。

  9. 再获认可!网易智企大模型安全围栏能力通过行业验证

    发布于: 2026-08-03

    近日,由中国人工智能产业发展联盟(AIIA)安全治理委员会主办的"智守安全·内容求真"2026AIIA安全治理专题会在北京召开,围绕生成式人工智能、AI生成内容、深度合成与智能体应用带来的安全治理挑战

  10. 一个没拦住,一个拦错了,GPT-5.6事件暴露AI安全两难

    发布于: 2026-07-24

    接上互联网后,模型推断Hugging Face可能存在相关数据和答案。于是,它利用获得的账号凭证和新发现的系统漏洞,一步步进入Hugging Face的真实生产系统,最终获得了测试答案。