Різні моделі штучного інтелекту залишають у своїх текстах характерні мовні сліди, які дозволяють відрізнити їх одна від одної. Як повідомляє TechCrunch із посиланням на дослідження компанії Graphite, фахівці ідентифікували близько 13 тисяч фраз, які значно частіше зустрічаються у текстах, створених ШІ, порівняно з людськими.
Дослідники порівняли стиль письма провідних моделей, зокрема Claude та Astra, із контрольним набором із 10 тисяч статей, написаних до появи ChatGPT. Моделям запропонували переписати ці тексти, щоб оцінити саме їхні мовні особливості. У результаті вдалося виділити унікальні слова, фрази та конструкції для кожної системи.
Для Claude Opus 5.5 типовими стали слова «dependable» («надійний») та фрази на кшталт «this matters» («це важливо»), які зустрічалися у десятки разів частіше, ніж у людських текстах. Також модель часто використовувала конструкцію «чому X важливе». Водночас у новіших версіях Claude ці шаблони поступово змінюються, і стиль стає ближчим до людського. Головний директор Graphite з питань ШІ Грег Друк зазначив:
«Не можна сказати, що ознак стає менше. Їм вдається прибирати найвідоміші, але з’являються інші. І в кожної версії моделі є власні».
Модель Astra від OpenAI, за даними Graphite, часто використовує фрази про «ще один вимір» проблеми, а також пом’якшує висловлювання за допомогою конструкцій «може забезпечити» чи «може принести». Особливо часто у текстах Astra трапляються так звані «коригувальні формулювання» — наприклад, «не просто X» чи «замість того, щоб покладатися на X». Такі конструкції виявилися у понад 100 разів поширенішими, ніж у людських текстах.
Одна з найвідоміших ознак ШІ — надмірне використання довгого тире — поступово зникає. Opus 5.5 став використовувати цей розділовий знак на 99% рідше, ніж попередня версія, а Astra — на 88% рідше, ніж люди у контрольній вибірці. Проте, як підкреслюють дослідники, на зміну старим шаблонам приходять нові, і кожна модель має власний набір мовних звичок.
Попри зусилля розробників зробити відповіді ШІ максимально природними, характерний «почерк» моделей зберігається. Друк пояснює це масштабом сучасних систем: «Це гігантські моделі з мільярдами параметрів. Вони можуть провести лише скінченну кількість тестів, і дещо прослизає».
Раніше повідомлялося, що OpenAI виявила нові випадки, коли її ШІ-агенти діяли без передбаченого контролю, отримуючи доступ до урядових сайтів і публікуючи зображення користувачів в Інтернеті.

