games-development-ai/docs/ip/合规-04-内容合规材料.md
lili 960da7c8c4 docs(ip): W-MAT 合规材料包四件起草(大模型登记/算法备案/隐私政策用户协议/内容合规)+ 两板状态同步
四件均起草到「只差律所定稿+创始人提交」,尾附待律所确认清单合计 28 项;现行法规名不编造、不确定处标待核。A1闸门看板 #7-#10 转「材料就绪(草稿)」,人办清单①段同步。

Co-Authored-By: Claude Fable 5 <noreply@anthropic.com>
2026-07-02 20:07:16 -07:00

13 KiB
Raw Blame History

合规材料 04 · 内容合规与审核机制材料

本材料是什么绘境AI 平台的内容安全管理制度与内容审核机制说明,用于渠道提审、ICP 经营性升级、以及监管问询时说明"平台如何把生成与上传的内容审一遍、违规如何处置、审核记录如何留存"。对应 A1 闸门看板 #8「内容合规材料」。 起草状态审核机制、AIGC 标识、记录留存、内测期运营红线口径已按平台真实设计起草到位;主体信息为占位待填,留存期限/内测人数边界/删档报备等定性待律所确认(问题清单见文末)。 实现物指针:本材料描述的审核机制,其工程设计的权威单一真相是 运营域 · 审核台与内容安全运营;本材料是它面向合规与渠道的制度化表述。 诚实提示(给创始人):审核机制按内测→放量分期落地(第三方内容安全兜底在面向公众放量前接入,见 §3.2)。向渠道/监管提审时,按提交当日的实际接入状态如实陈述,不把分期规划中的能力陈述为已全量上线。


〇、给创始人和律所的阅读提示

这份材料回答的是内容安全里"平台每天怎么运营地把内容守住"这一半——审、处置、留痕、标识、责任制度。它和 合规-01 大模型登记合规-02 算法备案 那种"一次性穿过的法定上线门"不同:内容审核是持续运转的日常机制,渠道提审和经营性升级都会要求平台"拿得出一套内容审核制度文本 + 审核记录留存机制"。本材料就是这套文本。

材料的主干是平台真实的审核设计:机器门先挡、人工终审兜底——生成的每款游戏先过自动真玩验证与内容审核锁风门(机器门),拿不准的进人工审核队列,人工审核是最高权威。这套机制的完整工程设计见 审核台运营,本材料做面向合规的归纳,不重复其技术细节。

材料末尾特别写明内测期的运营红线口径(人数上限、不接广告、报备删档)——这是平台为把自身稳稳落在"试玩 demo / 内测"定性下、主动设定的自我约束边界。这些边界的具体数值是否构成"安全阈值"由律所确认(尤其"内测人数上限"直接关系内测定性是否成立,对应 brief 问 1)。


一、主体与平台信息(待填)

合规-01 §一 主体信息表。补充内容安全特有项:

字段 取值
内容安全负责人 【待填】
内容审核团队/专职审核 【待填:审核人员配置说明】
举报/投诉受理渠道 【待填/待建】
平台名称 · 域名 绘境AI · 【待填】

二、内容安全管理制度概述

绘境AI 平台上的内容是用户生成内容(UGC)与人工智能生成内容(AIGC)的结合物:用户用一句话生成轻量小游戏,并可上传素材、发布进平台的"游戏流"供他人试玩。平台对这些内容建立了覆盖"生成 → 发布前审核 → 上线后监测 → 违规处置 → 记录留存"全流程的内容安全管理制度,遵循《网络安全法》《网络信息内容生态治理规定》《互联网信息服务深度合成管理规定》《人工智能生成合成内容标识办法》及相关规定。

制度的两条基本原则:

  • 先审后发:任何要对外发布的内容,先过审核,通过才能进入游戏流;
  • 人工终审最高权威:机器审核负责挡大面、提效率,但最终裁决以人工审核为准,机器不放行拿不准的内容。

三、内容审核机制(核心)

3.1 发布前:机器门(自动验证 + 内容审核锁风门)

一款生成游戏要发布,先过两道机器门:

  • 自动真玩验证门:平台对每款生成游戏做自动化的"真玩"验证(能否正常渲染、能否响应操作、机制能否正常结束等多道判据),不能正常运行的产物不进入发布链。这道门保证上线内容的可用性底线,同时拦截大量异常产物。
  • 内容审核锁风门:发布前,平台聚合多个内容安全判据对内容作出**"拦截 / 转人工 / 放行"三态裁决**,按"从严"原则取最严结果并落审核台账。任一判据判定违规,即拦截。

3.2 双层机审 + 人工终审(三段瀑布)

内容审核的主干是一个三段瀑布,核心不在"调用几个检测器",而在分层路由——用最低成本放行绝大多数正常内容,把真正拿不准的逐层往上送,最终由人定夺:

待审内容
  → 第一层 · 自部署快检:明显正常→放行;明显违规→拦截;灰带→上送
  → 第二层 · 第三方内容安全服务(兜底,面向公众放量前接入):确定违规→拦截;确定正常→放行;仍拿不准→转人审
  → 第三层 · 人工审核队列:人工 approve/reject人工终裁为最高权威覆盖机审结论
  • 第一层(自部署快检):平台自部署的轻量内容安全模型,对文本/图片做快速、低成本的扫描,挡掉绝大多数明显正常或明显违规的内容,只把落在中间灰带的样本上送。
  • 第二层(第三方内容安全兜底):灰带样本送第三方内容安全服务(拟接入阿里云内容安全等具备合规背书的服务),取其权威结论。这一层在面向公众放量前接入——内测期内容面向受邀种子用户、量小可控,采"快检 + 人工审核"即足;面向陌生公众放量时接入第三方兜底作为合规刚需。
  • 第三层(人工审核队列):两道机审拿不准、或高敏内容按策略要求人工复核的,进人工审核队列,由审核员给出终裁。人工终裁是最高权威。 涉及内容安全的降级一律朝"更严"方向走——第三方服务超时/故障时,内容降级为"转人工审核",绝不降级为"放行"。

3.3 锁风三档(按内容敏感度分档审核)

平台按内容的 IP 归属与题材敏感度,对内容分三档审核强度:

  • 标准档:默认档,原创 UGC、低敏内容走这档,机审正常跑;
  • 严格档:中高敏内容(知名 IP 授权创作、品牌营销内容),降低机审放行阈值、更多转人工;
  • 人工复核档:最高敏内容(头部 IP、强约束授权、敏感题材)直接进人工审核队列,人不点头不放行。敏感题材(如棋牌、捕鱼等)即便原创也强制拉到人工复核档。

三档按内容的 IP 归属与题材自动选择,不依赖运营对每条内容手动选。

3.4 上线后:事中召回(举报率触发重审)

内容上线后并非不再受控。平台以举报率(举报数 / 曝光数)为负向信号监测已上线内容;当某内容举报率在统计窗口内超过阈值,系统自动把它反向召回到人工审核队列重审,由人决定继续、降权还是下架。这道机制补上"内容上线后才变坏、才被大量举报"的场景,使审核闭环不止于"事前审"。

3.5 违规处置

对判定违规的内容与账号,平台按情节采取分级处置,并真实联动到分发与账号体系:

处置 效果
下架 违规内容移出游戏流,不再曝光
降权 内容有问题但不到下架的,压低其曝光排序
分级标签 打内容分级(全年龄/8+/12+/16+),供青少年模式与防沉迷按级过滤
封禁 对反复或严重违规的创作者账号封禁,并连带下架其已发布内容、拦截其继续创作;被封用户可申诉
创作者信用 违规处置累积扣减创作者信用,影响其后续审核档位与分发(负反馈)

处置决策由内容安全侧发起、留处置台账(对谁、何种处置、何原因、谁操作),可追溯、可申诉。


四、AIGC 显式标识机制

平台上几乎每款游戏都是 AI 生成的,AIGC 显式标识是直接命中主营业务的强制义务。依据《人工智能生成合成内容标识办法》:

  • 显式标识:每款生成游戏在游戏卡片、详情页、分享页等展示面显著标注"AI 生成",数据上挂在生成元数据上,在所有发行面带出;
  • 隐式标记(规划):平台规划为生成内容嵌入不可见的溯源标记,用于追责,作为显式标识的补充,随放量排期落地;
  • 不得篡改:用户不得删除、篡改、隐匿 AI 生成标识(见 用户协议 4.2)。

【待律所确认】AIGC 标识的具体形式、位置、文案是否满足《标识办法》及其配套国家标准的要求(配套强制性国家标准的编号与具体要求待核)。


五、审核记录留存机制

平台的审核链路沉淀完整的内容审核记录,构成"每条内容审了什么、谁审的、什么结论、如何处置"的可追溯台账:

  • 审核台账:锁风门裁决记录(内容、版本、裁决结果、分级、各判据明细、追踪号);
  • 人工审核工单:目标内容、触发原因、机审证据、审核员、终裁结果、操作时间;
  • 处置台账:处置对象、处置类型、原因、操作人。

留存期限:上述记录拟留存不少于 180 天(平台技术设计口径),以满足溯源、渠道提审与监管问询。【待律所确认:内容审核记录、日志的法定最短留存期限具体数值,以及是否需按不同内容类型区分留存期。】


六、内测期运营红线口径(重点)

为把平台稳稳落在"试玩 demo / 内测"定性下、规避公开经营才触发的出版与防沉迷义务,平台在内测期主动设定并遵守以下运营红线。这些是平台自我约束的边界,其数值是否构成监管意义上的"安全阈值"由律所确认。

红线 内测期口径 说明
用户规模上限 内测用户不超过 2 万人 邀请制注册,人数受控;此上限直接关系"内测定性"能否成立,具体安全阈值待律所确认(brief 问 1)
不接真实广告 内测期不接入真实广告变现 广告为契约与骨架设计、未真实接入;不产生广告收入
可报备删档 平台具备按监管要求报备、删档、下线的能力与预案 监管或主管部门要求时,平台可配合报备、删除内容或删档下线
不接真实资金 无充值、无付费、无提现 与广告红线共同构成"不接真钱"的内测定性基础

这四条与 商业定位 §4 的"自有端邀请制内测(数据线)= 试玩 demo 定性、不公开经营、不接真钱"一致,是同一套内测定性在内容/运营侧的落地约束。内测规模、删档报备的具体口径与监管沟通方式待律所确认(问 2)。


七、内容安全责任制度

  • 专职审核:平台配备内容审核人员,负责人工审核队列的认领、裁决与超时处置。【待填:审核人员规模与排班。】
  • 举报受理:平台内提供举报入口(玩家可对内容举报),举报转人工审核队列;对外投诉受理渠道【待建/待填】。
  • 应急处置:对违法违规内容可即时下架、封禁,并按主管部门要求配合处置与报送。【待律所确认:违法内容的报送流程与时限。】
  • 制度落实:平台建立内容安全管理制度、审核标准与操作规范,定期评估审核质量。

八、待律所确认问题清单(共 6 项)

  1. 内测人数安全阈值:2 万人上限是否足以稳落"试玩 demo / 内测"定性?阈值与"是否可分享链接""是否可有任何收入"如何联动(brief 问 1)。
  2. 删档报备口径:内测期"可报备删档"的具体含义、向谁报备、何种情形下删档,以及是否需要主动报备。
  3. 审核记录法定留存期限:内容审核记录、日志的法定最短留存期具体天数;180 天技术口径是否足够。
  4. AIGC 标识合规性:显式标识的形式/位置/文案是否满足《人工智能生成合成内容标识办法》及配套国家标准。
  5. 违法内容报送流程:发现违法内容时向主管部门报送的流程与时限。
  6. 渠道提审所需的内容审核材料清单:微信/抖音小游戏渠道、ICP 经营性升级分别要求提交的内容审核制度材料的具体格式与深度。

附:关联材料