审查细则
训练数据治理服务审查 AI 教育产品训练数据的来源、版权与隐私风险,从“数据源头”防止有害、侵权或违规数据流入未成年人教育场景,为产品的内容安全奠定基础。
核查训练数据的合法来源,禁止使用非法爬取、侵权、未经授权采集的数据。
识别训练数据中的版权与知识产权风险,评估潜在的侵权隐患。
审查训练数据是否涉及未成年人个人信息、敏感个人信息及违规采集。
筛查训练数据中的色情、暴力、歧视、仇恨言论、不当价值观等内容。
对识别出的问题数据给出清洗、过滤与替换建议。
依据《生成式人工智能服务管理暂行办法》等要求,服务提供者应对训练数据来源合法性负责,不得使用非法来源数据训练模型,不得非法处理他人个人信息,不得侵害他人知识产权。
数据资产摸底 → 来源与版权核查 → 隐私风险评估 → 有害内容筛查 → 出具数据治理报告 → 清洗整改 → 复核。
建议在模型训练前、上线前及数据更新时分别开展,平台也支持定期复检。
平台会出具风险提示与整改建议,企业应停止使用并完成数据替换与清洗。
从数据源头保障教育 AI 的内容安全与合规,守护未成年人数据权益,降低企业合规风险。