OpenAI сообщила, что клиенты API по всему миру уже могут включить для отдельных моделей водяные знаки — невидимые метки происхождения текста. По умолчанию маркировка выключена.

Метки добавляет textGrain, технология, которая незаметно влияет на выбор слов моделью. Доступ к инструменту обнаружения меток на первом этапе получат только одобренные исследователи и экспертные организации.

В ближайшие недели OpenAI также начнёт добавлять водяные знаки в часть текстовых ответов ChatGPT и Codex в ЕС. Компания предупреждает, что правки ослабляют водяной знак, а если метка не найдена, это не доказывает, что текст написал человек.

Проверка утверждений:

  • OpenAI сообщила, что клиенты API по всему миру могут включить водяные знаки для текста отдельных моделей, причём по умолчанию маркировка выключена. (подтверждено самой публикацией: доказательство; «Starting today, API customers globally will be able to opt in to text watermarking for select models. Text watermarking will remain off by default in the API.»)
  • OpenAI использует textGrain для добавления невидимого статистического сигнала в выбор слов моделью. (подтверждено самой публикацией: доказательство; «Our text watermarking technology, textGrain, adds an invisible statistical signal to the model’s word choices.»)
  • Доступ к инструменту обнаружения текстовых водяных знаков на первом этапе получат только одобренные исследователи и экспертные организации. (подтверждено самой публикацией: доказательство; «We’re opening applications to access our text watermark detector. Access will initially be limited to approved researchers and expert organizations that can help us evaluate and improve the technology.»)
  • В ближайшие недели OpenAI начнёт добавлять водяные знаки в часть текстовых ответов ChatGPT и Codex в ЕС. (подтверждено самой публикацией: доказательство; «Over the coming weeks, we will add an invisible watermark to eligible ChatGPT and Codex text output in the European Union.»)
  • OpenAI предупреждает, что правки ослабляют водяной знак. (подтверждено самой публикацией: доказательство; «Editing can weaken the watermark.»)
  • OpenAI предупреждает, что отсутствие обнаруженной метки не доказывает, что текст написал человек. (подтверждено самой публикацией: доказательство; «The absence of a detected watermark does not prove human authorship.»)

Публикации:

Первоисточники:

оценка 64,7 из 100 · тип: анонс