Разные модели искусственного интеллекта оставляют в своих текстах характерные языковые следы, которые позволяют отличить их друг от друга. Как сообщает TechCrunch со ссылкой на исследование компании Graphite, специалисты идентифицировали около 13 тысяч фраз, которые значительно чаще встречаются в текстах, созданных ИИ, по сравнению с человеческими.
Исследователи сравнили стиль письма ведущих моделей, в частности Claude и Astra, с контрольным набором из 10 тысяч статей, написанных до появления ChatGPT. Моделям предложили переписать эти тексты, чтобы оценить именно их языковые особенности. В результате удалось выделить уникальные слова, фразы и конструкции для каждой системы.
Для Claude Opus 5.5 типичными стали слова «dependable» («надежный») и фразы вроде «this matters» («это важно»), которые встречались в десятки раз чаще, чем в человеческих текстах. Также модель часто использовала конструкцию «почему X важно». В то же время в новых версиях Claude эти шаблоны постепенно меняются, и стиль становится ближе к человеческому. Главный директор Graphite по вопросам ИИ Грег Друк отметил:
«Нельзя сказать, что признаков становится меньше. Им удаётся убирать самые известные, но появляются другие. И у каждой версии модели есть свои».
Модель Astra от OpenAI, по данным Graphite, часто использует фразы про «ещё одно измерение» проблемы, а также смягчает высказывания с помощью конструкций «может обеспечить» или «может принести». Особенно часто в текстах Astra встречаются так называемые «корректирующие формулировки» — например, «не просто X» или «вместо того, чтобы полагаться на X». Такие конструкции оказались более чем в 100 раз распространённее, чем в человеческих текстах.
Одна из самых известных признаков ИИ — чрезмерное использование длинного тире — постепенно исчезает. Opus 5.5 стал использовать этот знак препинания на 99% реже, чем предыдущая версия, а Astra — на 88% реже, чем люди в контрольной выборке. Тем не менее, как подчёркивают исследователи, на смену старым шаблонам приходят новые, и каждая модель имеет собственный набор языковых привычек.
Несмотря на усилия разработчиков сделать ответы ИИ максимально естественными, характерный «почерк» моделей сохраняется. Друк объясняет это масштабом современных систем: «Это гигантские модели с миллиардами параметров. Они могут провести лишь конечное количество тестов, и кое-что проскакивает».
Ранее сообщалось, что OpenAI выявила новые случаи, когда её ИИ-агенты действовали без предусмотренного контроля, получая доступ к правительственным сайтам и публикуя изображения пользователей в Интернете.

