随着《生成式人工智能服务管理暂行办法》持续落地,大量企业在AI产品公测、商业化前夕都会遇到同一个难题:分不清自家产品到底要不要做大模型备案、前置条件还差哪些,如果盲目提交申报材料极易被驳回。

行业里非常常见的踩坑场景:
自研微调开源模型,误以为只是简单调用API不用备案;私有化模型准备面向公众开放,但缺失网络资质;材料准备大半,才发现算力、训练数据、安全体系不满足审核要求。

本文整合各地网信实操口径,整理一套可落地的备案前置自查清单,按照「适用范围判定→主体资质→网络部署→模型技术要求→数据合规→安全体系→申报材料」分层梳理。企业正式启动备案申报前逐项核验,有效避免反复返工。

重要说明:本文区分 大模型备案(自研/微调模型)大模型服务登记(纯调用第三方已备案API) 两条合规路径,两者要求完全不同,请勿混淆。

一、核心第一步:判定你是否需要办理大模型备案

先定性,避免选错合规路线,做无用功。

✅ 需要办理【大模型备案】(全部条件满足)

  1. 产品具备生成式AI能力,可以生成文本、图像、音频、视频、代码、虚拟数字内容;
  2. 面向中国大陆境内社会公众开放服务(官网、APP、小程序、对外API、公测、付费SaaS等,免费服务同样适用);
  3. 企业对模型拥有实质控制权,满足任意一条:
  • 自主预训练基座大模型;
  • 基于开源基座/第三方模型开展微调、增量训练、指令微调、参数优化;
  • 使用自有行业数据持续迭代、改造模型输出效果;
  1. 服务具备舆论属性或者社会动员能力。

⚠️ 仅需【大模型服务登记】,无需大模型备案(全部条件满足)

  1. 直接调用网信办公示名单内、已完成备案的第三方大模型;
  2. 不对基座模型进行训练、微调、权重修改;
  3. 仅做上层应用开发、Prompt编排、RAG知识库检索(知识库不参与模型训练)。

提醒:完成登记不等于免除合规义务,仍需落实内容安全,并推进生成合成类算法备案。

❌ 一般无需备案/登记(最终以属地网信部门认定为准)

  1. 模型仅限企业内部私有化使用,无对外访问入口,不向外部用户开放;
  2. 极小范围封闭内部测试,不对外开放注册、不提供公开访问;
  3. 严格屏蔽境内IP,仅面向境外用户提供服务(仍需要遵守当地法律法规)。

合规红线:不存在“先上线公测,后续补备案”的缓冲空间。监管常态化开展AI清朗专项整治,未经备案面向公众运营,存在产品下架、行政处罚风险。

二、大模型备案前置自查清单(自研/微调模型适用)

模块1:企业主体资质(申报基础门槛,缺项无法提交)

  • 申报主体为中国大陆境内注册独立企业法人,营业执照正常存续,无经营异常、重大行政处罚记录;个体工商户通常不具备申报资格
  • 明确备案责任人:法定代表人、模型安全负责人、数据安全负责人,备好任命文件与联系方式
  • 产品域名完成ICP备案;开展经营性AI服务(售卖会员、API接口)需持有ICP经营许可证
  • 具备算力、服务器合作协议,能够证明算力部署位置与资源权属
  • 可提供加盖公章的企业合规承诺书

模块2:部署与网络安全条件

  • 训练数据、推理数据、用户交互数据全部在中国境内存储、运算,禁止违规跨境传输
  • 可向监管提供稳定可用的产品测试账号,支持远程功能核验
  • 完成网络安全等级保护测评(至少二级,绝大多数地区要求等保三级),持有等保报告及备案证明
  • 系统交互日志、访问日志留存时长不少于6个月,支持安全溯源查询

模块3:模型技术能力(备案核心审核要点)

  • 完整归档模型资料:基座来源、参数规模、开发框架、版本信息、训练/微调周期
  • 梳理完整流程文档:预训练、微调、推理部署链路架构图
  • 明确模型能力边界,形成允许生成内容、禁止生成内容清单
  • 具备防护机制,抵御Prompt注入、越狱提示词攻击
  • 支持AI生成内容标识(文本元数据水印、图片隐形/显性水印),满足内容可溯源要求
  • 完成内部安全测试:幻觉风险、偏见歧视、深度伪造、有害请求拦截测试,留存测试报告

模块4:训练与标注数据合规(最高驳回风险项)

  • 训练数据集可完整溯源,区分自有数据、开源数据集、商业采购数据集
  • 外购、开源数据集具备授权协议、采购合同、开源许可证证明文件
  • 训练数据内个人信息已脱敏、去标识化,禁止使用非法爬虫抓取数据
  • 统计境外语料占比,形成境外引入数据风险评估说明
  • 建立标准化的数据清洗、过滤、去重流程并形成文档
  • 具备标准化标注规范、质检流程,留存标注质量抽检记录

模块5:内容安全与风险应急管理体系

  • 搭建分层审核机制:机器自动初审 + 人工复核流程
  • 风险内容策略库完备,覆盖政治、色情、暴力、歧视、虚假信息等场景
  • C端面向大众的产品需设计未成年人保护机制、青少年模式
  • 上线正式版《用户协议》《隐私政策》,明确AI生成内容权责、数据收集范围
  • 建立用户投诉渠道、违规内容处置流程、重大安全风险应急预案
  • 制定模型重大迭代方案,明确何时需要启动变更备案

模块6:申报所需全套材料前置筹备

  • 《生成式人工智能服务备案申请表》(使用属地网信官方模板,信息前后保持一致)
  • 大模型安全自评估报告(核心材料,参考国标GB/T 45654撰写)
  • 模型技术说明书、系统架构图、训练流程图
  • 数据合规证明材料:授权文件、脱敏说明、溯源资料
  • 各项安全管理制度、应急方案、内容安全管控方案
  • 企业资质复印件(营业执照、等保报告等,加盖公章)

三、纯调用第三方API(服务登记路线)精简自查清单

很多团队混淆备案和登记,单独整理清单供应用厂商核对:

  • 上游大模型已完成备案,可在官方公示名单查到备案编号
  • 持有与模型厂商签署正式API合作协议、商用授权文件
  • 不会利用接口数据对模型进行微调、二次训练
  • 应用侧独立搭建内容风控体系,不能完全依赖上游厂商内容过滤
  • 满足境内数据存储、日志留存、AI内容标识基础安全要求
  • 同步规划生成合成类算法备案工作

四、备案高频误区澄清

  1. ❌ 误区:开源模型本地部署,不收费就不用备案
    ✅ 正解:只要面向公众开放服务,无论免费或收费,自研/微调模型均需要备案。

  2. ❌ 误区:基座厂商完成备案,我的应用就无需任何合规手续
    ✅ 正解:应用运营方依然需要履行登记义务,落实内容安全主体责任。

  3. ❌ 误区:材料先用模板填充,授权文件后续补齐
    ✅ 正解:数据溯源、授权文件是首轮重点审查内容,缺失会直接驳回申请,拉长周期。

  4. ❌ 误区:模型小版本迭代不需要报备
    ✅ 正解:模型架构、训练数据集、核心能力发生重大调整,需要办理变更备案。

五、自查完成后落地行动建议

  1. 使用清单逐项标记完成/待完善项,优先补齐资质与技术短板,不要仓促提交备案;
  2. 清晰区分备案、登记两条路径,避免准备大量无关材料;
  3. 大模型备案与生成合成类算法备案可以并行推进,节约整体合规周期;
  4. 正式提交前组织内部模拟评审,提前应对监管常见问询。
Logo

汇聚全球AI编程工具,助力开发者即刻编程。

更多推荐