OpenAI в ближайшие недели начнет добавлять невидимый водяной знак к текстам, созданным ChatGPT и Codex.
О запуске технологии компания сообщила 5 октября. В OpenAI подчеркнули, что инструменты текстовой маркировки и обнаружения ИИ-контента пока находятся на ранней стадии и имеют ряд ограничений.
Водяной знак будет встраиваться в текст с помощью технологии textGrain. Она изменяет выбор слов по определенному статистическому принципу, формируя скрытый сигнал. Специальный детектор сможет проверять текст и определять наличие такой маркировки.
Одновременно OpenAI начнет принимать заявки от исследователей и экспертных организаций на доступ к детектору. На первом этапе его получат только одобренные специалисты, которые помогут оценить надежность технологии и возможности ее ответственного использования.
При этом компания предупреждает, что маркировка не позволяет со стопроцентной уверенностью установить происхождение текста. Эффективность определения снижается на коротких материалах, при жестких требованиях к формулировкам и после редактирования текста.
По данным тестов OpenAI, детектор обнаруживал водяной знак примерно в 80% текстов объемом около 200 токенов и в 95% материалов объемом около 400 токенов. Для математических текстов показатель был значительно ниже из-за ограниченного выбора возможных формулировок.