OpenAI начала применять невидимые водяные знаки для текстов, созданных ChatGPT. Этот новый метод, получивший название textGrain, начнёт использоваться в Европейском Союзе. Хотя водяной знак не виден во время чтения, специальный детектор может анализировать текст и выявлять сигнал, связанный с моделями OpenAI, как сообщает theverge.com.
Эта технология появится не только в ChatGPT, но и в Codex. В ближайшие недели OpenAI активирует textGrain для пользователей всех тарифов в ЕС, что связано с соблюдением требований закона ЕС об искусственном интеллекте (EU AI Act), предписывающего машиночитаемую маркировку контента, созданного генеративным ИИ.
В отличие от добавления скрытых символов или необычной пунктуации, textGrain меняет статистические характеристики выбора слов при генерации. OpenAI утверждает, что это позволяет создать сигнал, который специальный детектор способен выявить. Однако технология не обеспечивает стопроцентного распознавания текста, созданного ИИ.
Важно учитывать, что редактирование может ослабить водяной знак. В тестах OpenAI замена 10% слов на синонимы уменьшила вероятность обнаружения сигнала с 92% до 66%, а замена 25% слов — до 17%. Короткие тексты и материалы с ограниченным выбором слов также сложнее определить. Поэтому textGrain не может служить абсолютным доказательством того, что конкретный текст был генерирован ИИ.
Сначала OpenAI не будет предоставлять детектор всем пользователям. Доступ получат одобренные исследователи и профильные организации. API-клиенты по всему миру могут добровольно активировать водяные знаки для отдельных моделей, а компания планирует в дальнейшем открыть textGrain для сообщества, хотя его глобальное использование пока не станет стандартом.

