Reddit 上的一则讨论指出,OpenAI 针对付费用户的退出条款可能无法保护内部推理令牌,从而允许该公司将这些数据用于模型训练。争论的核心在于,由于用户无法直接接收这些隐藏令牌,它们在服务协议中是否构成“输出”存在歧义。
- 付费用户的退出政策通常保护“输出”,但推理令牌对消费者不可见。
- 推理令牌包含经过处理的用户输入和响应版本,使其在合成数据生成方面具有重要价值。
- 与 OpenAI 当前的条款不同,Anthropic 的协议并不要求用户必须接收输出,退出保护即可生效。
- 这一漏洞可能使 OpenAI 能够将推理数据纳入预训练或中期训练混合数据中,而不违反强化学习优化限制。
这一区别意义重大,因为它表明如果内部模型状态仍被用于改进未来版本,那么选择退出训练可能无效。