OpenAI представила textGrain — технологию, которая поможет определять тексты, созданные её нейросетями. В ближайшие недели маркировка появится в ChatGPT и Codex на всех тарифах для пользователей в Евросоюзе. Так компания планирует выполнить требования европейского закона об искусственном интеллекте.
TextGrain работает во время генерации: технология влияет на выбор слов, оставляя в тексте статистический след. Его может распознать специальный детектор. Для читателя метка незаметна.
Метка не гарантирует, что текст нейросети удастся распознать. После редактирования обнаружить её сложнее: в тесте OpenAI детектор находил метку примерно в 92% исходных фрагментов. После замены 10% слов синонимами этот показатель снизился до 66%, а после замены четверти слов — до 17%. В другом тесте детектор обнаруживал около 80% меток во фрагментах на 200 токенов и 95% — в текстах на 400.
Пока доступ к детектору маркировки получат только одобренные исследователи и экспертные организации. OpenAI предупреждает: система может ошибаться, а отсутствие метки не доказывает, что текст написан человеком.
Похожие невидмые метки уже внедряет Anthropic в ответы Claude, чтобы определять тексты, созданные нейросетью. Маркировка работает по всему миру, а не только в ЕС.
Больше интересного про код — в нашем телеграм-канале. Подписывайтесь!