Обсуждение на Reddit показывает, что условия отказа от использования данных платными пользователями OpenAI могут не защищать внутренние токены рассуждений, потенциально позволяя компании использовать эти данные для обучения моделей. Аргумент сосредоточен на неоднозначности того, образуют ли эти скрытые токены «Вывод» согласно соглашению об обслуживании, учитывая, что пользователи не получают их напрямую.

  • Политики отказа платных пользователей обычно защищают «Вывод», но токены рассуждений не видны потребителю.
  • Токены рассуждений содержат обработанные версии входных данных пользователя и ответов, что делает их ценными для генерации синтетических данных.
  • В отличие от текущих условий OpenAI, соглашение Anthropic не требует, чтобы пользователь получал вывод, чтобы применялись защиты отказа.
  • Эта лазейка может позволить OpenAI включать данные рассуждений в смеси предварительного или промежуточного обучения без нарушения ограничений оптимизации RL.

Это различие имеет значение, поскольку оно предполагает, что отказ от обучения может быть неэффективным, если внутренние состояния модели все еще используются для улучшения будущих версий.