ChatGPT будет помечать свои тексты водяным знаком
Функция под названием textGrain появится у пользователей из Евросоюза в ближайшее время, сообщили в Open AI. Так компания пытается соответствовать европейскому законодательству
Читать на полной версииВодяные знаки ChatGPT будет оставлять в самом тексте. При генерации модель статистически подберет слова таким образом, чтобы на выходе в тексте был определенный считываемый сигнал. При этом для человеческого глаза он будет незаметен, распознать наличие водяного знака можно только при помощи специального детектора — доступ к нему предоставит сама же OpenAI. Пока функция вводится для пользователей из Европы.
Ранее аналогичный инструмент в новые модели Claude внедрила компания Anthropic.
ИИ-стартапы озаботились возможностью детекции на фоне вступления в силу правил прозрачности, прописанных в новом законе Евросоюза об искусственном интеллекте. Они предусматривают, в частности, возможность машинного распознавания сгенерированного текста. Продолжает генеральный директор компании Nevel.ai Алексей Хахунов:
Однако точную детекцию водяного знака будет обеспечивать конкретная последовательность слов, сгенерированная искусственным интеллектом. Что встречается крайне редко — публиковать нейросетевой текст без правок, пусть даже минимальных, уже давно считается дурным тоном.
Так что поймать кого-то за руку благодаря новой функции вряд ли получится, объясняет директор Angel Relations Group и преподаватель ВШЭ Алексей Карлов:
Алексей Карлов директор Angel Relations Group и преподаватель ВШЭ «Сам способ скорее про кодирование последовательности слов, которые нейросеть уже написала, для того чтобы записать этот так называемый слепок или определенный водяной знак. Вопрос: насколько люди будут переписывать текст, который сгенерировала нейросеть? Если человек будет переписывать значительную часть абзаца, менять слова местами, дополнять смысл, какие-нибудь междометия, то знак, конечно, не сохранится, поскольку сама формула, которая была закодирована при старте, банально не сработает. Теоретически эти знаки можно усовершенствовать, если нейросети будут публиковать или держать какую-либо базу данных со всеми генерациями, которые они выпускают. Но самая сложная задача определения следов нейросети в тексте — это когда текст составляется вместе с человеком. Если человек пишет сам и редактирует с нейросетью или, наоборот, пишет с нейросетью, а потом редактирует сам, то определить это практически невозможно».
В самой Open AI признают: если заменить даже 10% сгенерированного текста синонимами, вероятность обнаружения водяного знака падает с 92% до 66%. А если поменять четверть слов, точность детекции будет всего 17%.