games-development-ai/docs/ip/合规-04-内容合规材料.md
lili 960da7c8c4 docs(ip): W-MAT 合规材料包四件起草(大模型登记/算法备案/隐私政策用户协议/内容合规)+ 两板状态同步
四件均起草到「只差律所定稿+创始人提交」,尾附待律所确认清单合计 28 项;现行法规名不编造、不确定处标待核。A1闸门看板 #7-#10 转「材料就绪(草稿)」,人办清单①段同步。

Co-Authored-By: Claude Fable 5 <noreply@anthropic.com>
2026-07-02 20:07:16 -07:00

165 lines
13 KiB
Markdown
Raw Blame History

This file contains ambiguous Unicode characters

This file contains Unicode characters that might be confused with other characters. If you think that this is intentional, you can safely ignore this warning. Use the Escape button to reveal them.

# 合规材料 04 · 内容合规与审核机制材料
> **本材料是什么**绘境AI 平台的内容安全管理制度与内容审核机制说明,用于渠道提审、ICP 经营性升级、以及监管问询时说明"平台如何把生成与上传的内容审一遍、违规如何处置、审核记录如何留存"。对应 [A1 闸门看板](../mvp/A1闸门看板.md) #8「内容合规材料」。
> **起草状态**审核机制、AIGC 标识、记录留存、内测期运营红线口径已按平台真实设计起草到位;**主体信息为占位待填,留存期限/内测人数边界/删档报备等定性待律所确认**(问题清单见文末)。
> **实现物指针**:本材料描述的审核机制,其工程设计的权威单一真相是 [运营域 · 审核台与内容安全运营](../architecture/运营/审核台运营.md);本材料是它面向合规与渠道的制度化表述。
> **诚实提示(给创始人)**:审核机制按内测→放量分期落地(第三方内容安全兜底在面向公众放量前接入,见 §3.2)。**向渠道/监管提审时,按提交当日的实际接入状态如实陈述,不把分期规划中的能力陈述为已全量上线。**
---
## 〇、给创始人和律所的阅读提示
这份材料回答的是内容安全里"平台每天怎么运营地把内容守住"这一半——审、处置、留痕、标识、责任制度。它和 [合规-01 大模型登记](合规-01-大模型登记材料.md)、[合规-02 算法备案](合规-02-算法备案材料.md) 那种"一次性穿过的法定上线门"不同:内容审核是**持续运转的日常机制**,渠道提审和经营性升级都会要求平台"拿得出一套内容审核制度文本 + 审核记录留存机制"。本材料就是这套文本。
材料的主干是平台真实的审核设计:**机器门先挡、人工终审兜底**——生成的每款游戏先过自动真玩验证与内容审核锁风门(机器门),拿不准的进人工审核队列,**人工审核是最高权威**。这套机制的完整工程设计见 [审核台运营](../architecture/运营/审核台运营.md),本材料做面向合规的归纳,不重复其技术细节。
材料末尾特别写明**内测期的运营红线口径**(人数上限、不接广告、报备删档)——这是平台为把自身稳稳落在"试玩 demo / 内测"定性下、主动设定的自我约束边界。这些边界的**具体数值是否构成"安全阈值"由律所确认**(尤其"内测人数上限"直接关系内测定性是否成立,对应 brief 问 1)。
---
## 一、主体与平台信息(待填)
同 [合规-01 §一](合规-01-大模型登记材料.md) 主体信息表。补充内容安全特有项:
| 字段 | 取值 |
|---|---|
| 内容安全负责人 | 【待填】 |
| 内容审核团队/专职审核 | 【待填:审核人员配置说明】 |
| 举报/投诉受理渠道 | 【待填/待建】 |
| 平台名称 · 域名 | 绘境AI · 【待填】 |
---
## 二、内容安全管理制度概述
绘境AI 平台上的内容是**用户生成内容(UGC)与人工智能生成内容(AIGC)的结合物**:用户用一句话生成轻量小游戏,并可上传素材、发布进平台的"游戏流"供他人试玩。平台对这些内容建立了覆盖"**生成 → 发布前审核 → 上线后监测 → 违规处置 → 记录留存**"全流程的内容安全管理制度,遵循《网络安全法》《网络信息内容生态治理规定》《互联网信息服务深度合成管理规定》《人工智能生成合成内容标识办法》及相关规定。
制度的两条基本原则:
- **先审后发**:任何要对外发布的内容,先过审核,通过才能进入游戏流;
- **人工终审最高权威**:机器审核负责挡大面、提效率,但最终裁决以人工审核为准,机器不放行拿不准的内容。
---
## 三、内容审核机制(核心)
### 3.1 发布前:机器门(自动验证 + 内容审核锁风门)
一款生成游戏要发布,先过两道机器门:
- **自动真玩验证门**:平台对每款生成游戏做自动化的"真玩"验证(能否正常渲染、能否响应操作、机制能否正常结束等多道判据),不能正常运行的产物不进入发布链。这道门保证上线内容的**可用性底线**,同时拦截大量异常产物。
- **内容审核锁风门**:发布前,平台聚合多个内容安全判据对内容作出**"拦截 / 转人工 / 放行"三态裁决**,按"从严"原则取最严结果并落审核台账。任一判据判定违规,即拦截。
### 3.2 双层机审 + 人工终审(三段瀑布)
内容审核的主干是一个三段瀑布,核心不在"调用几个检测器",而在**分层路由**——用最低成本放行绝大多数正常内容,把真正拿不准的逐层往上送,最终由人定夺:
```
待审内容
→ 第一层 · 自部署快检:明显正常→放行;明显违规→拦截;灰带→上送
→ 第二层 · 第三方内容安全服务(兜底,面向公众放量前接入):确定违规→拦截;确定正常→放行;仍拿不准→转人审
→ 第三层 · 人工审核队列:人工 approve/reject人工终裁为最高权威覆盖机审结论
```
- **第一层(自部署快检)**:平台自部署的轻量内容安全模型,对文本/图片做快速、低成本的扫描,挡掉绝大多数明显正常或明显违规的内容,只把落在中间灰带的样本上送。
- **第二层(第三方内容安全兜底)**:灰带样本送第三方内容安全服务(拟接入阿里云内容安全等具备合规背书的服务),取其权威结论。**这一层在面向公众放量前接入**——内测期内容面向受邀种子用户、量小可控,采"快检 + 人工审核"即足;面向陌生公众放量时接入第三方兜底作为合规刚需。
- **第三层(人工审核队列)**:两道机审拿不准、或高敏内容按策略要求人工复核的,进人工审核队列,由审核员给出终裁。**人工终裁是最高权威。** 涉及内容安全的降级一律朝"更严"方向走——第三方服务超时/故障时,内容降级为"转人工审核",绝不降级为"放行"。
### 3.3 锁风三档(按内容敏感度分档审核)
平台按内容的 IP 归属与题材敏感度,对内容分三档审核强度:
- **标准档**:默认档,原创 UGC、低敏内容走这档,机审正常跑;
- **严格档**:中高敏内容(知名 IP 授权创作、品牌营销内容),降低机审放行阈值、更多转人工;
- **人工复核档**:最高敏内容(头部 IP、强约束授权、敏感题材)直接进人工审核队列,人不点头不放行。敏感题材(如棋牌、捕鱼等)即便原创也强制拉到人工复核档。
三档按内容的 IP 归属与题材自动选择,不依赖运营对每条内容手动选。
### 3.4 上线后:事中召回(举报率触发重审)
内容上线后并非不再受控。平台以**举报率**(举报数 / 曝光数)为负向信号监测已上线内容;当某内容举报率在统计窗口内超过阈值,系统自动把它**反向召回**到人工审核队列重审,由人决定继续、降权还是下架。这道机制补上"内容上线后才变坏、才被大量举报"的场景,使审核闭环不止于"事前审"。
### 3.5 违规处置
对判定违规的内容与账号,平台按情节采取分级处置,并真实联动到分发与账号体系:
| 处置 | 效果 |
|---|---|
| **下架** | 违规内容移出游戏流,不再曝光 |
| **降权** | 内容有问题但不到下架的,压低其曝光排序 |
| **分级标签** | 打内容分级(全年龄/8+/12+/16+),供青少年模式与防沉迷按级过滤 |
| **封禁** | 对反复或严重违规的创作者账号封禁,并连带下架其已发布内容、拦截其继续创作;被封用户可申诉 |
| **创作者信用** | 违规处置累积扣减创作者信用,影响其后续审核档位与分发(负反馈) |
处置决策由内容安全侧发起、留处置台账(对谁、何种处置、何原因、谁操作),可追溯、可申诉。
---
## 四、AIGC 显式标识机制
平台上几乎每款游戏都是 AI 生成的,**AIGC 显式标识是直接命中主营业务的强制义务**。依据《人工智能生成合成内容标识办法》:
- **显式标识**:每款生成游戏在游戏卡片、详情页、分享页等展示面**显著标注"AI 生成"**,数据上挂在生成元数据上,在所有发行面带出;
- **隐式标记(规划)**:平台规划为生成内容嵌入不可见的溯源标记,用于追责,作为显式标识的补充,随放量排期落地;
- **不得篡改**:用户不得删除、篡改、隐匿 AI 生成标识(见 [用户协议](合规-03-隐私政策与用户协议.md) 4.2)。
> 【待律所确认】AIGC 标识的具体形式、位置、文案是否满足《标识办法》及其配套国家标准的要求(配套强制性国家标准的编号与具体要求待核)。
---
## 五、审核记录留存机制
平台的审核链路沉淀完整的内容审核记录,构成"每条内容审了什么、谁审的、什么结论、如何处置"的可追溯台账:
- **审核台账**:锁风门裁决记录(内容、版本、裁决结果、分级、各判据明细、追踪号);
- **人工审核工单**:目标内容、触发原因、机审证据、审核员、终裁结果、操作时间;
- **处置台账**:处置对象、处置类型、原因、操作人。
**留存期限**:上述记录**拟留存不少于 180 天**(平台技术设计口径),以满足溯源、渠道提审与监管问询。【待律所确认:内容审核记录、日志的**法定最短留存期限**具体数值,以及是否需按不同内容类型区分留存期。】
---
## 六、内测期运营红线口径(重点)
为把平台稳稳落在"试玩 demo / 内测"定性下、规避公开经营才触发的出版与防沉迷义务,平台在内测期主动设定并遵守以下运营红线。**这些是平台自我约束的边界,其数值是否构成监管意义上的"安全阈值"由律所确认。**
| 红线 | 内测期口径 | 说明 |
|---|---|---|
| **用户规模上限** | 内测用户不超过 **2 万人** | 邀请制注册,人数受控;此上限直接关系"内测定性"能否成立,**具体安全阈值待律所确认(brief 问 1)** |
| **不接真实广告** | 内测期**不接入真实广告变现** | 广告为契约与骨架设计、未真实接入;不产生广告收入 |
| **可报备删档** | 平台具备按监管要求**报备、删档、下线**的能力与预案 | 监管或主管部门要求时,平台可配合报备、删除内容或删档下线 |
| **不接真实资金** | 无充值、无付费、无提现 | 与广告红线共同构成"不接真钱"的内测定性基础 |
> 这四条与 [商业定位](../architecture/产品/商业定位.md) §4 的"自有端邀请制内测(数据线)= 试玩 demo 定性、不公开经营、不接真钱"一致,是同一套内测定性在内容/运营侧的落地约束。**内测规模、删档报备的具体口径与监管沟通方式待律所确认(问 2)。**
---
## 七、内容安全责任制度
- **专职审核**:平台配备内容审核人员,负责人工审核队列的认领、裁决与超时处置。【待填:审核人员规模与排班。】
- **举报受理**:平台内提供举报入口(玩家可对内容举报),举报转人工审核队列;对外投诉受理渠道【待建/待填】。
- **应急处置**:对违法违规内容可即时下架、封禁,并按主管部门要求配合处置与报送。【待律所确认:违法内容的报送流程与时限。】
- **制度落实**:平台建立内容安全管理制度、审核标准与操作规范,定期评估审核质量。
---
## 八、待律所确认问题清单(共 6 项)
1. **内测人数安全阈值**:2 万人上限是否足以稳落"试玩 demo / 内测"定性?阈值与"是否可分享链接""是否可有任何收入"如何联动(brief 问 1)。
2. **删档报备口径**:内测期"可报备删档"的具体含义、向谁报备、何种情形下删档,以及是否需要主动报备。
3. **审核记录法定留存期限**:内容审核记录、日志的法定最短留存期具体天数;180 天技术口径是否足够。
4. **AIGC 标识合规性**:显式标识的形式/位置/文案是否满足《人工智能生成合成内容标识办法》及配套国家标准。
5. **违法内容报送流程**:发现违法内容时向主管部门报送的流程与时限。
6. **渠道提审所需的内容审核材料清单**:微信/抖音小游戏渠道、ICP 经营性升级分别要求提交的内容审核制度材料的具体格式与深度。
---
## 附:关联材料
- [运营域 · 审核台与内容安全运营](../architecture/运营/审核台运营.md)——本材料所述机制的工程设计权威 SoT
- [合规-01 大模型登记材料](合规-01-大模型登记材料.md)——生成内容安全措施(§四)与本材料同源
- [合规-02 算法备案材料](合规-02-算法备案材料.md)——举报率召回、内容处置对分发的联动
- [合规-03 隐私政策与用户协议](合规-03-隐私政策与用户协议.md)——用户侧的内容责任与未成年人保护
- [律所合规咨询 brief](../mvp/律所合规咨询brief.md)——问 1(内测定性/出版)、问 2(防沉迷)
- [运营域 · 合规闸门](../architecture/运营/合规闸门.md)——本项在 12+1 道闸门中的位置(#8)