Компания Anthropic начала внедрять в новые модели Claude незаметную маркировку текстов, созданных искусственным интеллектом. Как утверждает разработчик, такая метка не влияет на смысл и читаемость материала, сохраняется при копировании и вставке, а в некоторых случаях может пережить редактирование.
Технология призвана повысить прозрачность происхождения контента и усложнить выдачу сгенерированных текстов за полностью авторские. В Anthropic сравнивают механизм с цифровым водяным знаком — скрытым обозначением, которое помогает установить происхождение файла или материала.
Какие модели получат маркировку
Функция доступна в моделях Claude, выпущенных 2 августа или позднее. Anthropic намерена добавить её и в более ранние версии. Маркировка будет применяться к материалам, созданным Claude по всему миру, включая случаи, когда модель используют через облачных провайдеров.
Компания также планирует предоставить сторонним организациям инструменты для обнаружения таких меток. Это может быть полезно издательствам, школам и университетам при проверке работ, происхождение которых вызывает сомнения.
Внедрение связано с обязательствами Anthropic по повышению прозрачности в рамках европейского Закона об искусственном интеллекте — AI Act.
Возможности и ограничения
Маркировка не станет безусловным доказательством того, что текст написал Claude. След может остаться, например, если нейросеть использовали лишь для вычитки или перевода. В то же время сильное редактирование, перефразирование, перевод на другой язык или смешивание результата Claude с другими текстами способны сделать метку необнаружимой.
Тем не менее технология может стать дополнительным инструментом в спорах о происхождении текстов. Издательская отрасль уже сталкивалась с подобными конфликтами. В июле литературный агент отозвал криминальный роман Call Me, I’ll Hide the Body после подозрений в использовании генеративного ИИ. Автор книги Джерри Фаладе отрицал, что писал произведение с помощью нейросети.
Ранее издательство Hachette сняло с публикации хоррор-роман Мии Баллард Shy Girl после обвинений в применении ИИ. Писательница заявляла, что не использовала нейросети при работе над книгой, однако добавила, что приглашённый редактор включил в текст сгенерированные фрагменты без её ведома.
Anthropic стала второй крупной ИИ-компанией, объявившей о маркировке сгенерированных текстов. В 2024 году Google DeepMind сообщила, что применяет технологию SynthID для обозначения текстов и видео, созданных в приложении и веб-версии Gemini.
Мнение редакции
Маркировка не решит проблему подмены авторства сама по себе: её можно ослабить переводом, переработкой и смешением с человеческим текстом. Однако появление проверяемого технического следа меняет саму логику дискуссии – у редакторов и преподавателей появляется не окончательный вердикт, а ещё один способ внимательно изучить происхождение материала.