OpenAI сообщила, что клиенты API по всему миру уже могут включить для отдельных моделей водяные знаки — невидимые метки происхождения текста. По умолчанию маркировка выключена.
Метки добавляет textGrain, технология, которая незаметно влияет на выбор слов моделью. Доступ к инструменту обнаружения меток на первом этапе получат только одобренные исследователи и экспертные организации.
В ближайшие недели OpenAI также начнёт добавлять водяные знаки в часть текстовых ответов ChatGPT и Codex в ЕС. Компания предупреждает, что правки ослабляют водяной знак, а если метка не найдена, это не доказывает, что текст написал человек.
Проверка утверждений:
- OpenAI сообщила, что клиенты API по всему миру могут включить водяные знаки для текста отдельных моделей, причём по умолчанию маркировка выключена. (подтверждено самой публикацией: доказательство; «Starting today, API customers globally will be able to opt in to text watermarking for select models. Text watermarking will remain off by default in the API.»)
- OpenAI использует textGrain для добавления невидимого статистического сигнала в выбор слов моделью. (подтверждено самой публикацией: доказательство; «Our text watermarking technology, textGrain, adds an invisible statistical signal to the model’s word choices.»)
- Доступ к инструменту обнаружения текстовых водяных знаков на первом этапе получат только одобренные исследователи и экспертные организации. (подтверждено самой публикацией: доказательство; «We’re opening applications to access our text watermark detector. Access will initially be limited to approved researchers and expert organizations that can help us evaluate and improve the technology.»)
- В ближайшие недели OpenAI начнёт добавлять водяные знаки в часть текстовых ответов ChatGPT и Codex в ЕС. (подтверждено самой публикацией: доказательство; «Over the coming weeks, we will add an invisible watermark to eligible ChatGPT and Codex text output in the European Union.»)
- OpenAI предупреждает, что правки ослабляют водяной знак. (подтверждено самой публикацией: доказательство; «Editing can weaken the watermark.»)
- OpenAI предупреждает, что отсутствие обнаруженной метки не доказывает, что текст написал человек. (подтверждено самой публикацией: доказательство; «The absence of a detected watermark does not prove human authorship.»)
Публикации:
Первоисточники:
- https://openai.com/index/eu-text-provenance
- https://cdn.openai.com/pdf/e9508624-d767-41b6-a26d-e34ca798ada6/textgrain-entropy-calibrated-watermarking-for-language-model-text.pdf
- https://huggingface.co/datasets/rexarski/eli5_category
- https://artificialintelligenceact.eu/article/50
- https://support.claude.com/en/articles/16266773-how-claude-marks-ai-generated-content
- https://openai.com/index/understanding-the-source-of-what-we-see-and-hear-online
- https://openai.com/index/advancing-content-provenance
- https://developers.openai.com/api/docs/guides/content-provenance
- https://github.com/facebookresearch/textseal
- https://help.openai.com/en/articles/8912793-provenance-signals-in-openai-generated-content
оценка 64,7 из 100 · тип: анонс