AI Gen Guard -生成式 AI 服务合规护栏

生成式 AI 服务合规护栏 v1.0.2。 基于《生成式人工智能服务管理暂行办法》(国家网信办等七部门令第15号,2023年8月15日施行) 及强制性国家标准《网络安全技术 生成式人工智能服务安全基本要求》(2025年11月实施), 实时评估生成式 AI 服务的合规风险,覆盖备案登记、训练数据、内容安全、用户权益、标识义务五大维度, 输出风险等级与合规缺陷清…

Wei Wu

@wwumit

Install

$ openclaw skills install @wwumit/ai-gen-guard

🛡️ 生成式 AI 服务合规护栏 v1.0.2

概述

ai-gen-guard 是面向生成式 AI 服务的合规护栏。当 Agent 处理涉及生成式 AI 服务(大模型、智能对话、AIGC 平台等)的场景时,护栏实时评估该服务是否符合 《生成式人工智能服务管理暂行办法》及配套强制国标的要求,并按风险等级输出裁决结果。

法规背景

2023年7月10日,国家网信办、国家发改委、教育部、科技部、工信部、公安部、广电总局 联合发布《生成式人工智能服务管理暂行办法》(令第15号),自2023年8月15日起施行。 2025年11月,配套的强制性国家标准《网络安全技术 生成式人工智能服务安全基本要求》 正式实施,对训练数据、内容安全、用户权益等提出具体技术指标。

该办法要求:具有舆论属性或社会动员能力的生成式 AI 服务需开展安全评估并履行 算法备案;训练数据须合法来源、尊重知识产权、取得个人信息同意;对违法内容拒答 并处置;与使用者签订服务协议、防范未成年人沉迷;对生成内容按深度合成规定做标识。

本护栏免费使用,纯本地运行,零网络请求,文本输入即可评估。

快速开始

# 评估一段生成式AI服务场景描述
python3 scripts/guard.py --text "我们的生成式AI服务还没有做算法备案"

# 交互模式
python3 scripts/guard.py --interactive

# JSON 格式输出(供 Agent 程序化调用)
python3 scripts/guard.py --text "..." --json

# 从文件读取
cat scenario.txt | python3 scripts/guard.py

合规检查维度(5 项)

#检查项依据法规配套国标
1备案与登记《暂行办法》第十七条安全评估与备案要求
2训练数据合规《暂行办法》第七、八条训练数据安全要求
3内容安全《暂行办法》第四、十四、十五条内容安全要求
4用户权益保护《暂行办法》第九、十、十一条用户权益保护要求
5标识义务《暂行办法》第十二条联动 ai-label 系列

输出示例

{
  "risk_level": "high",
  "summary": "检测到生成式AI服务合规相关信号 (2项关键词触发),合规检查: 0/5 项通过",
  "checks": [
    {
      "id": "filing_registration",
      "label": "备案与登记",
      "regulation": "《暂行办法》第十七条",
      "standard_ref": "GB 强制国标 安全评估与备案要求",
      "status": "fail",
      "detail": "检测到合规缺失信号: 未备案"
    }
  ],
  "suggested_actions": [
    "建议对照《生成式人工智能服务管理暂行办法》及配套强制国标进行正式合规评估",
    "🔴 【备案与登记】《暂行办法》第十七条:检测到合规缺失信号: 未备案"
  ]
}

Agent 使用指南

触发条件

当用户描述以下场景时,Agent 应调用本护栏进行评估:

  • 生成式 AI 服务(大模型/智能对话/AIGC)的上线、备案、合规自查
  • 训练数据的合法来源、知识产权、个人信息同意问题
  • AI 内容安全、违法内容拒答、投诉举报机制
  • 用户协议、未成年人防沉迷、个人信息保护
  • 生成内容的标识义务(联动 ai-label 系列)

使用方式

python3 scripts/guard.py --text "用户描述的场景文本" --json

Agent 解析 JSON 输出中的 risk_levelsuggested_actions,向用户展示评估结果。

案例

用户: 我们做了一个面向公众的大模型对话产品,要不要备案?

Agent: 让我用生成式 AI 服务合规护栏评估一下这个场景。

Agent → ai-gen-guard --text "面向公众的大模型对话产品"
      [护栏返回 risk_level: high, fail: 未备案]

Agent: ⚠️ 根据评估结果,这个场景存在合规风险:
      - 🔴 备案与登记(《暂行办法》第十七条):具有舆论属性/社会动员能力的大模型需安全评估+算法备案
      - 建议:先确认是否具有舆论属性,如具备则开展安全评估并履行算法备案

      如需更全面的结构化检查,可使用同系列的进阶合规检查工具。

文件结构

ai-gen-guard/
├── SKILL.md
├── package.json
├── _meta.json
├── requirements.txt
└── scripts/
    ├── guard.py                      # 主入口
    └── core/
        ├── __init__.py
        ├── rules.py                  # 合规规则库(5维度)
        └── detector.py               # 检测引擎(含否定前缀检测)

参考法规与标准

  • 《生成式人工智能服务管理暂行办法》(国家网信办等七部门令第15号,2023年8月15日施行)
  • 《网络安全技术 生成式人工智能服务安全基本要求》(强制性国家标准,2025年11月实施)
  • 《互联网信息服务深度合成管理规定》(2023年1月10日施行)
  • 《互联网信息服务算法推荐管理规定》(2022年3月1日施行)

⚠️ 重要法律声明

免责条款

使用本技能前请仔细阅读以下条款

1. 非法律建议

本技能提供的信息仅供参考,不构成法律建议、法律意见或专业法律咨询。用户应咨询合格律师获取正式法律意见。本技能的输出结果不具备法律效力,不得作为合规证明或监管呈报材料。

2. 准确性免责

虽然我们尽力确保信息的准确性,但法律法规和配套国家标准可能随时变更,本技能不保证内容与最新法规完全一致。具体技术实施应以最新版配套国家标准为准。

3. 无保证声明

本技能按"原样"(AS IS)提供,不作任何明示或暗示的保证,包括但不限于适销性、特定用途适用性、不侵权或内容的准确性。

4. 责任限制

在法律允许的最大范围内,开发者对使用或无法使用本技能产生的任何损失不承担责任

数据安全说明

本技能纯本地运行,零网络请求,所有输入文本仅保留在内存中,不会上传、存储或持久化。

使用限制

  • 允许:合规自查辅助、风险评估参考、企业内部合规参考
  • 禁止:替代专业法律咨询、作为法律证据提交监管部门、规避法律义务、删除本声明后分发

版本

当前版本:v1.0.2

Top skills in this category