AI Gen Guard -生成式 AI 服务合规护栏
生成式 AI 服务合规护栏 v1.0.2。 基于《生成式人工智能服务管理暂行办法》(国家网信办等七部门令第15号,2023年8月15日施行) 及强制性国家标准《网络安全技术 生成式人工智能服务安全基本要求》(2025年11月实施), 实时评估生成式 AI 服务的合规风险,覆盖备案登记、训练数据、内容安全、用户权益、标识义务五大维度, 输出风险等级与合规缺陷清…
Wei Wu
@wwumit
Install
$ openclaw skills install @wwumit/ai-gen-guard🛡️ 生成式 AI 服务合规护栏 v1.0.2
概述
ai-gen-guard 是面向生成式 AI 服务的合规护栏。当 Agent 处理涉及生成式 AI 服务(大模型、智能对话、AIGC 平台等)的场景时,护栏实时评估该服务是否符合 《生成式人工智能服务管理暂行办法》及配套强制国标的要求,并按风险等级输出裁决结果。
法规背景
2023年7月10日,国家网信办、国家发改委、教育部、科技部、工信部、公安部、广电总局 联合发布《生成式人工智能服务管理暂行办法》(令第15号),自2023年8月15日起施行。 2025年11月,配套的强制性国家标准《网络安全技术 生成式人工智能服务安全基本要求》 正式实施,对训练数据、内容安全、用户权益等提出具体技术指标。
该办法要求:具有舆论属性或社会动员能力的生成式 AI 服务需开展安全评估并履行 算法备案;训练数据须合法来源、尊重知识产权、取得个人信息同意;对违法内容拒答 并处置;与使用者签订服务协议、防范未成年人沉迷;对生成内容按深度合成规定做标识。
本护栏免费使用,纯本地运行,零网络请求,文本输入即可评估。
快速开始
# 评估一段生成式AI服务场景描述
python3 scripts/guard.py --text "我们的生成式AI服务还没有做算法备案"
# 交互模式
python3 scripts/guard.py --interactive
# JSON 格式输出(供 Agent 程序化调用)
python3 scripts/guard.py --text "..." --json
# 从文件读取
cat scenario.txt | python3 scripts/guard.py
合规检查维度(5 项)
| # | 检查项 | 依据法规 | 配套国标 |
|---|---|---|---|
| 1 | 备案与登记 | 《暂行办法》第十七条 | 安全评估与备案要求 |
| 2 | 训练数据合规 | 《暂行办法》第七、八条 | 训练数据安全要求 |
| 3 | 内容安全 | 《暂行办法》第四、十四、十五条 | 内容安全要求 |
| 4 | 用户权益保护 | 《暂行办法》第九、十、十一条 | 用户权益保护要求 |
| 5 | 标识义务 | 《暂行办法》第十二条 | 联动 ai-label 系列 |
输出示例
{
"risk_level": "high",
"summary": "检测到生成式AI服务合规相关信号 (2项关键词触发),合规检查: 0/5 项通过",
"checks": [
{
"id": "filing_registration",
"label": "备案与登记",
"regulation": "《暂行办法》第十七条",
"standard_ref": "GB 强制国标 安全评估与备案要求",
"status": "fail",
"detail": "检测到合规缺失信号: 未备案"
}
],
"suggested_actions": [
"建议对照《生成式人工智能服务管理暂行办法》及配套强制国标进行正式合规评估",
"🔴 【备案与登记】《暂行办法》第十七条:检测到合规缺失信号: 未备案"
]
}
Agent 使用指南
触发条件
当用户描述以下场景时,Agent 应调用本护栏进行评估:
- 生成式 AI 服务(大模型/智能对话/AIGC)的上线、备案、合规自查
- 训练数据的合法来源、知识产权、个人信息同意问题
- AI 内容安全、违法内容拒答、投诉举报机制
- 用户协议、未成年人防沉迷、个人信息保护
- 生成内容的标识义务(联动 ai-label 系列)
使用方式
python3 scripts/guard.py --text "用户描述的场景文本" --json
Agent 解析 JSON 输出中的 risk_level 和 suggested_actions,向用户展示评估结果。
案例
用户: 我们做了一个面向公众的大模型对话产品,要不要备案?
Agent: 让我用生成式 AI 服务合规护栏评估一下这个场景。
Agent → ai-gen-guard --text "面向公众的大模型对话产品"
[护栏返回 risk_level: high, fail: 未备案]
Agent: ⚠️ 根据评估结果,这个场景存在合规风险:
- 🔴 备案与登记(《暂行办法》第十七条):具有舆论属性/社会动员能力的大模型需安全评估+算法备案
- 建议:先确认是否具有舆论属性,如具备则开展安全评估并履行算法备案
如需更全面的结构化检查,可使用同系列的进阶合规检查工具。
文件结构
ai-gen-guard/
├── SKILL.md
├── package.json
├── _meta.json
├── requirements.txt
└── scripts/
├── guard.py # 主入口
└── core/
├── __init__.py
├── rules.py # 合规规则库(5维度)
└── detector.py # 检测引擎(含否定前缀检测)
参考法规与标准
- 《生成式人工智能服务管理暂行办法》(国家网信办等七部门令第15号,2023年8月15日施行)
- 《网络安全技术 生成式人工智能服务安全基本要求》(强制性国家标准,2025年11月实施)
- 《互联网信息服务深度合成管理规定》(2023年1月10日施行)
- 《互联网信息服务算法推荐管理规定》(2022年3月1日施行)
⚠️ 重要法律声明
免责条款
使用本技能前请仔细阅读以下条款:
1. 非法律建议
本技能提供的信息仅供参考,不构成法律建议、法律意见或专业法律咨询。用户应咨询合格律师获取正式法律意见。本技能的输出结果不具备法律效力,不得作为合规证明或监管呈报材料。
2. 准确性免责
虽然我们尽力确保信息的准确性,但法律法规和配套国家标准可能随时变更,本技能不保证内容与最新法规完全一致。具体技术实施应以最新版配套国家标准为准。
3. 无保证声明
本技能按"原样"(AS IS)提供,不作任何明示或暗示的保证,包括但不限于适销性、特定用途适用性、不侵权或内容的准确性。
4. 责任限制
在法律允许的最大范围内,开发者对使用或无法使用本技能产生的任何损失不承担责任。
数据安全说明
本技能纯本地运行,零网络请求,所有输入文本仅保留在内存中,不会上传、存储或持久化。
使用限制
- ✅ 允许:合规自查辅助、风险评估参考、企业内部合规参考
- ❌ 禁止:替代专业法律咨询、作为法律证据提交监管部门、规避法律义务、删除本声明后分发
版本
当前版本:v1.0.2
Top skills in this category
Prompt Guard
@seojoonkim650+ pattern AI agent security defense covering prompt injection, supply chain injection, memory poisoning, action gate bypass, unicode steganography, cascad...
OpenClaw Token Optimizer
@asif2bdOpenClaw Token Optimizer v3.2.0 — practical cost-control toolkit for OpenClaw agents. Lazy context loading, Sonnet/Opus-aware routing, heartbeat scheduling,...
Google Docs
@hith3shGoogle Docs API integration with managed OAuth. Search, read, create, and update Google Docs documents. Use this skill when users want to read document text,...
google-docs
@byungkyuGoogle Docs API integration with managed OAuth. Create documents, insert text, apply formatting, and manage content. Use this skill when users want to interact with Google Docs. For other third party apps, use the api-gateway skill (https://clawhub.ai/byungkyu/api-gateway). Calls run through the `maton` CLI with OAuth login; default to read and list calls, and confirm every write or new connection with the user.
Canva
@abgohelCreate, export, and manage Canva designs via the Connect API. Generate social posts, carousels, and graphics programmatically.