中文站

易盾动态

新一代数字内容风控领军者

  1. 清朗专项行动升级,平台如何应对未成年人网络保护新要求?

    发布于: 2026-08-14

    中央网信办部署启动为期4个月的“清朗·未成年人网络保护”专项行动,集中整治涉未成年人乱象,压实网站平台主体责任。易盾将未成年人保护拆解为身份识别、内容治理与技术约束三个核心层面。

  2. 权威认可|网易智企两项大模型安全能力入选金融业人工智能安全工具首批权威目录

    发布于: 2026-08-13

    网易智企·易盾大模型安全评测入选AI安全测试类、大模型安全围栏入选AI安全防护类,双双入选金融业人工智能安全工具首批征集名单,覆盖大模型应用上线前评估与运行中防护两大关键环节。

  3. 企业AI Agent安全如何守住边界?从“能干活”到“干得稳”

    发布于: 2026-08-11

    Agent正加速进入企业,能力边界扩张重新定义AI风险边界。本文从数字员工视角解析模型之外的安全控制面、“内生安全+围栏防护”体系与Agent Guard方案,帮助企业让智能始终运行在明确边界内。

  4. 审核之外,还有件更耗人的事:内容质量标注

    发布于: 2026-08-11

    内容质量标注在部分客户场景中人力投入甚至高于安全审核。CMA借助大模型理解自然语言标准,把业务标准转化为内容类别与质量等级标签,覆盖图文分类、视频分级、联合达标等场景,为平台内容管理提供结构化依据。

  5. 网易智企重磅发布《AI安全白皮书》,让AI看得见、管得住、测得出、追得回

    发布于: 2026-08-07

    网易智企携手金山办公、Minimax正式发布《AI安全白皮书》,提出五层风险框架与五维半定量评估体系,面向智能体时代给出AI安全治理的落地路径。

  6. 新规落地后,拟人化互动服务如何建立安全合规体系?

    发布于: 2026-08-04

    随着《人工智能拟人化互动服务管理暂行办法》(以下简称《办法》)的落地实施,拟人化互动服务的合规议题,正在从“如何理解新规”进入“如何完成自评估、如何把要求落到产品和运营流程里”的阶段。

  7. 再获认可!网易智企大模型安全围栏能力通过行业验证

    发布于: 2026-08-03

    近日,由中国人工智能产业发展联盟(AIIA)安全治理委员会主办的"智守安全·内容求真"2026AIIA安全治理专题会在北京召开,围绕生成式人工智能、AI生成内容、深度合成与智能体应用带来的安全治理挑战

  8. 一个没拦住,一个拦错了,GPT-5.6事件暴露AI安全两难

    发布于: 2026-07-24

    接上互联网后,模型推断Hugging Face可能存在相关数据和答案。于是,它利用获得的账号凭证和新发现的系统漏洞,一步步进入Hugging Face的真实生产系统,最终获得了测试答案。

  9. 从"能用AI"到"敢用AI",网易智企给出AI时代可信安全答案

    发布于: 2026-07-22

    2026世界人工智能大会上,AI安全成为核心议题。《主席声明》提出构建法律法规、技术监测、风险预警体系,为AI治理划定基本框架。

  10. 《主席声明》的"必要护栏",为什么成为AI全球治理的关键词?

    发布于: 2026-07-21

    7月17日,《2026世界人工智能大会暨人工智能全球治理高级别会议主席声明》发布。在这份讨论人工智能创新、应用、安全与全球合作的文件中,有一句话格外具体:“为人工智能大模型加装必要护栏。”