
当前企业智能体部署已呈现规模化落地阶段多元化、异构化的智能体已深度融入企业核心生产业务系统和办公开发场景。在很大程度重塑了企业现有的 IT 架构导致安全风险激增给传统安全防护体系带来了极大冲击与挑战。这就要求企业重新思考构建适配 AI 时代的安全防护和治理体系框架。基于字节内部 AI 安全治理最佳实践火山引擎发布《智能体安全能力图谱》系统性梳理了智能体安全建设的10 大能力维度、60 项核心技术要素。管理范围包括WorkFlow 类智能体、办公类智能体、AI Coding 类智能体。扫描图中二维码获取高清图及详细能力介绍1. 智能体合规准入在智能体设计及规划阶段安全就要介入基于智能体岗位职责、行为权限、使用场景等做好分类分级构建符合智能体岗位职责的安全基准线并形成可嵌入的安全描述文件为后续安全管控做好准入准备。2. 智能体资产与供应链安全上线前则需构建智能体及其核心组件清单AI-BOM并对资产进行细粒度盘点帮助企业管理员“看清智能体资产”。针对资产供应链风险扫描开展定期巡检从源头管控供应链安全风险。3. 内容安全合规聚焦智能体输入输出内容安全检测结合监管合规要求、实时拦截有害内容并针对不同行业属性、提供红线敏感话题深度管控。针对 AI 生成内容深度鉴伪打标签保障安全合规。4. 常态化安全测评与加固通过“合规测评”、“红队测评”实现安全左移构建智能体安全上线准入要求并提供整改加固建议进一步降低准入带来的安全风险。同时可结合企业准入注册流程构建常态化安全测评与加固。5. AI 安全网关企业规模化推广智能体落地时AI 安全网关承载了企业智能体及其核心资产调用、流量与路由管控的统一管控面。通过实现智能体统一接入、敏感数据识别与脱敏、数据跨境管控、模型路由、资源耗尽防护和成本治理等关键能力降低企业算力消耗的同时实现出入口全面防护。6. 身份与认证管理构建智能体非人类身份体系赋予每个智能体及其组件唯一身份标识并与人类用户身份进行链接通过可信身份令牌验证智能体身份叠加委托链与意图声明用于跨服务的全链路身份传播使其可在全生命周期过程和每个任务的委托链条中体现人类用户的授权同意并被纳入统一的访问控制和审计追溯范围。提供智能体通过技能功能访问后端资源的凭据托管能力避免将敏感凭据直接写入工具代码或配置文件。7. 权限与访问控制以用户、智能体为主体其他智能体、知识库、技能工具等为客体对象配置权限规则并在运行态对用户-总控智能体-子智能体-知识库、插件、工具集的委托链全过程各个节点的权限进行权限控制基于业务需求实时构建权限申请和审批流在任务执行过程中赋予用户所需的权限基于智能体可接受行为准则和用户上下文进行动态权限管理对于高风险且偏离正常业务逻辑的行为进行阻断或强制HITL人机协同。8. 运行时安全监控与防护智能体运行时全链路检测防护针对特有安全风险如工具滥用、越权、记忆投毒、注入攻击等提供实时检测拦截能力。并针对不同业务场景提供灵活自定义能力实现不同行业不同场景下的精准检防护。9. 安全可观测性与运营管理通过较长时间的智能体动作全量日志记录、可观测行为审计、智能体事件行为分析、以及自动化处置响应等可将风险发现与响应能力沉淀为常态化运营体系。如建立智能体 UEBA基于智能体用户行为构建、AEBA基于智能体行为构建基准帮助企业最终实现动态化场景运营并沉淀。10. 模型与推理安全实现模型推理的机密计算防护能力以芯片级信任为根基依托端到端全链路加密远程证明完备的可追溯审计能力帮助企业以轻量化投入实现等同于私有化部署的高等级安全防护。企业构建智能体安全管理体系建议基于企业智能体建设所处阶段以及安全需求程度大致分成 3 个阶段L1-智能体基础安全AI防护、L2-智能体精细化管控、L3-智能体安全持续运营为企业提供一条从“基础防护”走向“体系化治理”到“可持续运营”的完整防护路径。L1智能体基础 AI 安全防护先解决“能否安全上线”企业现状企业刚刚部署智能体平台已有少量智能体应用企业有基础的 AI 安全和数据安全合规要求。智能体安全建设需求实现智能体基础安全 AI 防护该阶段覆盖四个维度1 智能体合规准入2 智能体资产与供应链安全3 内容安全合规4 常态化安全测评与加固。L1 的目标是为每一个进入企业环境的智能体建立统一、可执行的安全基线。L2智能体精细化管控再解决“运行过程是否可控”企业现状企业已经开始推广 WorkFlow 类智能体、办公和开发类智能体企业用户可以通过模型网关自由选择内外部模型企业有商业敏感数据对于 AI 安全合规有较高要求。智能体安全建设需求实现智能体精细化安全管控该阶段覆盖四个维度5 AI 安全网关6 身份与认证管理7 权限与访问控制8 运行时安全监控与防护L2 的目标围绕统一入口、可信身份、细粒度授权与运行时拦截建立覆盖每一次调用和执行的控制体系确保智能体走向“体系化治理”。L3智能体安全持续运营最终解决“规模化后能否持续运营机密可信”企业现状企业智能体建设和应用比较成熟WorkFlow 类智能体已经全面融合到企业各业务系统办公和开发类智能体已经全员普及行业头部属于关基业务的企业对于 AI 安全合规数据安全有非常要求。智能体安全建设需求实现智能体安全持续运营该阶段覆盖两个维度9 安全可观测性与运营管理10 模型与推理安全。L3 的目标是让企业不仅能够全面发现和处置风险还能基于全链路数据持续验证安全状态、优化策略实现可持续运营并做到模型推理过程的机密可信。火山引擎本次发布的《智能体安全能力图谱》希望为企业提供一套可建设、可运营、可持续演进的 AI 时代安全治理框架构建企业员工与智能体的一体化安全管理体系助力企业实现 AI 智能体的可信、可控、可管。诚挚的邀请各位专家加入火山 AI 安全技术交流群一起交流探讨智能体安全能力建设和企业实践。