Лучшее за неделю

Эксперт: универсальной скрытой метки ИИ-текста не существует

Универсальной скрытой метки, которая позволяла бы однозначно определить, что текст написан нейросетью, сегодня не существует. Об этом «Газете.Ru» рассказала AI/ML-инженер и эксперт по большим языковым моделям Надежда Широглазова.

По словам специалиста, под «меткой ИИ» могут подразумевать несколько разных технологий. Самый простой вариант — скрытые символы Unicode как необычные пробелы или символы нулевой ширины. В них действительно можно закодировать информацию, но само наличие таких символов ещё ничего не доказывает.

Другой вариант — метаданные файла. PDF или DOCX иногда содержит сведения о программе, в которой был создан документ, или историю изменений. Однако эти данные относятся к файлу, а не непосредственно к тексту, и после копирования в новый документ часто исчезают.

«Наиболее интересный и технологически сложный вариант — статистический водяной знак. Нейросеть создаёт текст последовательно, выбирая следующий токен из нескольких вариантов. Алгоритм watermarking немного влияет на этот выбор, формируя статистическую закономерность, которую затем можно обнаружить с помощью специального ключа», — говорит Широглазова.

Такую закономерность нельзя увидеть при обычном чтении или убрать сменой шрифта. Но перевод, существенное переписывание или повторная генерация текста другой моделью могут ослабить сигнал.

Эксперт также призвала осторожнее относиться к публичным AI-детекторам. Они обычно анализируют стиль, предсказуемость слов и структуру предложений, а показатель вроде «85% AI» не является доказательством происхождения текста.

«Универсального способа сделать нейросетевой текст гарантированно нераспознаваемым сегодня нет, а любой итоговый материал после использования AI-инструментов необходимо самостоятельно перечитывать и проверять», — резюмирует Широглазова.