报告概述

本报告由火山引擎发布,系统梳理了大模型在快速迭代与落地过程中面临的安全威胁,包括安全攻击风险、数据安全担忧及政策法规要求。报告重点介绍了火山方舟MaaS平台的安全承诺与责任共担模型,并详细阐述了其构建的以可信安全沙箱为核心的全栈安全可信保障体系,涵盖模型平台安全、可信推理服务、数据隐私保护、内容安全保障、MCP与智能体安全等六大维度。报告旨在帮助企业用户了解大模型服务安全风险,并展示火山方舟在安全可控前提下推动AI可持续发展的实践路径。

报告的核心结论

大模型安全风险沿基础设施、模型平台、智能体链条延伸

报告指出,生成式AI的安全风险已不局限于传统应用层,而是沿AI基础设施、大模型、智能体链条逐步延伸。从算力滥用、数据泄露到提示词注入、工具滥用,攻击者可通过多环节切入,需从基础设施与平台层面着手实施纵深防御。

火山方舟以可信安全沙箱为核心构建全栈防护体系

火山方舟围绕数据传输、存储、运行环境、访问控制、审计日志五个维度,结合云原生容器沙箱、网络隔离、透明加密文件系统、零信任架构等技术构建可信安全沙箱,为模型推理与精调提供端到端安全防护,实现链路全加密、数据高保密、环境强隔离、操作可审计。

MaaS原生机密推理服务提供硬件级安全保护

火山方舟在行业内率先推出MaaS原生的机密推理服务,基于芯片级TEE技术实现从物理芯片到容器的全链路安全隔离。用户可一键开启,在获得更高安全等级的同时通过远程证明报告验证环境可信性,且默认支持PD分离式高性能推理框架,确保安全与效率兼顾。

内容安全护栏实现全模态输入输出双向审核

火山方舟构建了覆盖文本、图像、音视频的多模态内容审核体系,对用户输入和模型输出进行双向闭环审核。在默认基础风控之上,支持客户按场景配置增值风控服务,并具备动态迭代与溯源能力,有效防御内容诱导生成等典型风险。

报告回答的关键问题

大模型服务面临哪些主要安全风险?

报告总结了大模型服务面临的三大类安全风险:一是安全攻击风险,包括提示词注入、算力消耗、模型滥用、供应链漏洞等传统与新型威胁;二是数据安全担忧,涉及数据安全性、可控性与所有权问题;三是政策法规要求,需遵守国内外人工智能相关法律法规,如中国《生成式人工智能服务管理暂行办法》及欧盟《人工智能法案》等。

如何保障大模型推理数据的隐私安全?

火山方舟通过可信安全沙箱保护推理会话数据,默认提供网络层加密并支持用户开启应用层端到端会话加密。推理数据在传输、存储、计算各阶段均受保护:传输全链路加密,存储落盘加密,计算在隔离环境中进行且任务结束后沙箱销毁。用户还可选择机密推理服务,将推理任务运行在硬件级TEE中,从根本上杜绝非授权访问。

火山方舟如何实现MaaS平台的安全可信?

火山方舟围绕模型安全、平台安全、云平台基础安全构建了“全球合规、原生安全、客户信任”的安全可信保障体系。具体包括:可信安全沙箱、全链路加密、多维度环境隔离、IAM权限管理、多类别审计日志,以及大模型防火墙、云安全产品如WAF、HIDS、CDTR等。同时通过DevSecOps流程、红蓝演练、漏洞管理等措施持续加固平台安全。

报告中的代表性数据

50万亿

豆包大模型日均Tokens处理量

2025年12月,相比2024年5月首次推出时增长了417倍,反映大模型使用规模的爆发式增长。

49.2%

中国公有云大模型服务市场份额

2025年上半年,据IDC报告,火山引擎以该份额位居行业第一,体现其市场领导地位。

以上数据根据报告摘要整理,具体统计口径和数值请以完整报告原文为准。

完整报告包含什么

  • 详细的大模型安全威胁分析:涵盖安全攻击风险(如提示词注入、算力消耗、模型滥用)、数据安全担忧(数据安全性、可控性、所有权)及政策法规要求,结合OWASP TOP 10 for LLM风险分析,配以完整的攻击风险概览图。
  • 火山方舟安全承诺与责任共担模型:清晰界定火山方舟与客户在安全、隐私、合规三方面的责任边界,并附有责任共担模型图及相关服务协议链接。
  • 火山大模型安全可信能力全景图:展示从模型安全、平台安全到云平台基础安全的完整防护框架,以及风险防护与监管合规的对应关系。
  • 模型平台安全机制深度解析:涵盖可信安全沙箱的五个维度(加密通信、环境隔离、访问控制、审计日志等),以及全链路加密、多层级数据加密、应用层会话加密、云原生容器沙箱vArmor、网络隔离、可信数据访问代理等技术的实现细节。
  • 可信推理服务(机密推理)完整技术方案:包括MaaS原生机密推理服务架构、芯片级安全隔离、端到端数据保护、硬件级密钥托管、可验证透明信任机制,以及远程证明服务、基线管理服务等核心组件的详细说明。
  • 数据隐私保护全生命周期措施:覆盖推理、精调、知识库、上下文缓存等场景的数据链路与安全机制,包含“数据零留存”承诺、数据加密存储、自持密钥HYOK、会话无痕、沙箱销毁等具体实践。
  • 内容安全保障体系:从模型原生安全(豆包大模型训练数据合规、安全对齐、评测与红队)到平台默认内容安全护栏(全模态审核、分层风险识别、输入输出双向闭环),再到选配风控增值服务,形成多层次内容安全防线。
  • MCP与智能体安全架构:展示MCP全生命周期安全架构,涵盖安全准入控制、原生安全设计、运行时安全防护(大模型防火墙、AgentArmor),以及应用实验室中零代码、低代码、高代码应用构建的安全机制。
  • 合规资质与认证清单:列出火山引擎已获得的20余项国际国内认证,包括ISO 42001人工智能管理体系、ISO 27001信息安全、ISO 27701隐私信息管理、SOC审计、信通院可信云认证、等保三级等。
  • 火山方舟大模型服务安全能力清单附录:以表格形式汇总MaaS平台安全、大模型攻击防护、基础安全保障、产品安全保障等各项安全能力的默认提供与可选开启状态,便于用户对照评估。

本页内容由川海智库整理,用于帮助读者快速了解报告主题、核心观点和主要内容。由于报告量大、人工能力有限,部分观点、数据、统计口径或表述可能存在偏差,具体内容请以完整报告原文为准。

相关报告