← 返回首页|安全博客

Twitch默认收集内容训练AI引众怒 默认选项成合规雷区

📅 2026-08-17

一、事件回顾:默认开启的AI训练授权

近日,亚马逊旗下直播平台Twitch被曝默认允许将创作者与观众产生的内容用于训练亚马逊的AI模型,引发全球主播与用户的强烈不满。据英国广播公司报道,这一设置默认处于开启状态,用户需要主动进入设置才能选择退出。Twitch首席产品官迈克·明顿在直播中坦言:"如果默认不开启,根本不会有人主动选择加入。"这句"诚实回答"反而加剧了争议——它等于承认默认收集并非出于用户意愿,而是平台单方面追求数据便利。

数据用途方面,用户频道内容可能被用于训练生成式AI模型。例如,主播的音频可能被用来优化语音转文字模型,进而改善Twitch直播与亚马逊视频的自动字幕效果;游戏开发者则担忧,主播在直播中呈现的大量游戏画面与交互数据,同样会被纳入训练语料。Twitch方面强调数据不会被转售给第三方公司,但这并未平息质疑,许多人追问:为何不采取默认关闭、事先征得同意的做法?事件发酵后,部分头部主播公开呼吁观众共同施压,并要求平台公开训练数据的用途清单,一场围绕"用户数据到底属于谁"的讨论在直播圈迅速蔓延。

二、"默认收集"为何是数据合规雷区

默认开启与默认关闭,一字之差,法律含义截然不同。欧盟通用数据保护条例确立了"默认数据保护"原则,要求默认采用最有利于用户隐私的设置,并规定同意必须是自由、具体、知情且明确的。我国个人信息保护法同样要求处理个人信息应取得个人同意,处理敏感个人信息、向第三方提供个人信息等场景还需取得单独同意。默认勾选、默认开启的做法,在严格执法语境下很难被认定为有效同意。

更关键的是,生成式AI的训练数据合规已进入监管视野。国内生成式人工智能服务管理暂行办法明确要求训练数据来源合法、不得侵害他人合法权益。若将用户内容默认纳入训练语料,一旦涉及肖像、声音、未成年人信息或商业秘密,合规风险将成倍放大。国外监管实践也已给出信号:多家大型平台曾因"同意机制不透明"收到高额罚单,默认选项正在成为各国执法部门审查的焦点。对企业而言,仅靠一纸用户协议中的笼统授权条款,已难以覆盖AI训练这种持续、大规模的数据利用行为。

三、不止Twitch:AI厂商的"默认收集"趋势

几乎同一时期,OpenAI在macOS桌面端推出"计算机历史"功能,记录用户的点击与按键操作,构建个人行为时间线,供ChatGPT与Codex在用户发起请求时引用,甚至能自动接手用户未完成的任务。官方称该功能不像微软Windows Recall那样截取屏幕图像,只记录"事件",但隐私担忧依旧存在。

从微软Recall的截图风波,到Twitch默认训练授权,再到ChatGPT桌面端的行为追踪,共同信号是:AI智能体时代,厂商比以往更渴望获取用户行为数据。这类数据往往高度敏感——工作习惯、沟通节奏、社交关系网络一旦泄露或被滥用,危害远大于单条口令失窃,而且数据一旦进入训练语料便难以撤回。更值得警惕的是,行为数据常被当作"训练素材"与"产品功能"的双重用途,用户很难判断自己的一次点击究竟是在使用服务,还是在为他人模型"贡献语料"。

四、对青海政企的启示与建议

青海正处于数字化转型与AI应用落地的窗口期,政务云、智慧医疗、智慧教育等场景纷纷引入大模型与智能体。在采购和使用AI服务时,建议重点关注四点:一是审查供应商数据处理条款,明确训练数据来源、用途与存储位置,警惕"默认收集"类条款;二是处理个人信息坚持告知-同意与默认最小化原则,涉及敏感信息的场景采用单独同意;三是建立训练数据合规清单,涉及公民个人信息、未成年人数据的必须先行脱敏;四是定期开展数据合规自查与安全评估,将AI训练数据纳入等级保护与数据安全治理体系。

默认选项不是小事,它体现产品对用户权利的态度,也是合规风险的源头。对政企而言,把"默认合规"写进采购合同与管理制度,比事后补救成本低得多。

© 2026 西宁惠康电子有限公司 | 青海·西宁

🛡️ 西宁惠康电子 · 青海本地
你的系统,扛得住这类攻击吗?
企业安全体检:开放端口 + 漏洞 + 等保差距,一次查清。首单 ¥198,24 小时出报告。
立即预约体检 →
企业安全体检 ¥198 首单体验价免费咨询