动态资讯>大模型安全围栏
-
企业AI Agent安全如何守住边界?从“能干活”到“干得稳”
发布于: 2026-08-11Agent正加速进入企业,能力边界扩张重新定义AI风险边界。本文从数字员工视角解析模型之外的安全控制面、“内生安全+围栏防护”体系与Agent Guard方案,帮助企业让智能始终运行在明确边界内。
-
网易智企重磅发布《AI安全白皮书》,让AI看得见、管得住、测得出、追得回
发布于: 2026-08-07网易智企携手金山办公、Minimax正式发布《AI安全白皮书》,提出五层风险框架与五维半定量评估体系,面向智能体时代给出AI安全治理的落地路径。
-
拟人化互动服务安全评估的评估维度有哪些?8项内容逐项拆解
发布于: 2026-08-07拟人化互动服务安全评估评什么?答案在《办法》第二十三条:8项评估内容构成自查主线,企业可对照逐项盘点、按制度技术运营证据四层准备材料。
-
AI产品上架应用商店,安全评估与备案如何核验?
发布于: 2026-08-07AI产品上架应用商店多了一道核验关,应用商店需核验拟人化互动服务的安全评估与备案情况,违规将不予上架、警示、暂停或下架。
-
AI陪伴产品如何防止用户沉迷和情感依赖?
发布于: 2026-08-06AI陪伴产品防沉迷需要完整治理机制:识别依赖风险信号、把健康指标纳入产品看板、设计规范时长提醒与便捷退出、对高风险用户分级干预,落实新规防沉迷要求。
-
拟人化互动服务的投诉举报和重大风险整改怎么做?
发布于: 2026-08-06拟人化互动服务需设置便捷有效的投诉举报入口、明确处理时限与反馈闭环,并建立从发现风险到整改复测、记录留存的重大风险整改机制。
-
大模型备案、算法备案与安全评估,企业要过几道关?
发布于: 2026-08-06大模型备案、算法备案与拟人化互动安全评估依据不同法规、针对不同对象,三层合规架构叠加缺一不可,企业需分别准备、统筹推进。
-
易盾如何帮助AI陪伴产品满足新规要求?
发布于: 2026-08-06易盾从大模型安全围栏、CMA审核智能体、未成年人保护、安全评估与备案支撑四方面,帮助AI陪伴产品建立覆盖模型、产品、运营和处置的全链路治理能力。
-
拟人化互动服务要上线了,安全评估报告怎么写?
发布于: 2026-08-06安全评估报告核心不在写而在做:对照办法第二十三条八项评估内容,将制度、技术、运营、证据四层材料整理成文,向省级网信部门提交。
-
AI陪伴产品极端情境怎么处置?识别、安抚与干预流程拆解
发布于: 2026-08-06用户表达极端情绪或出现风险信号时,AI陪伴产品应从陪聊模式切换为安全处置模式,通过识别、安抚、干预三层机制完成规范处置,落实新规对极端情境应急处置的合规要求。