Модель штучного інтелекту Claude, розроблена компанією Anthropic, вже бере участь у виконанні 26% ключових завдань, пов’язаних із дослідженням і розробкою нових поколінь ШІ. Про це компанія повідомила у своєму першому відкритому звіті про внутрішні показники автоматизації. Ще у березні 2026 року цей показник становив лише 1%, що свідчить про стрімке зростання ролі ШІ у власному розвитку.
Anthropic представила три основні групи метрик: індекс автоматизації досліджень і розробок, показники нагляду за агентами ШІ та дані про розподіл обчислювальних ресурсів. У компанії пояснили, що ці вимірювання мають допомогти громадськості, незалежним експертам і урядам краще оцінювати темпи розвитку передових моделей. Anthropic також планує надати незалежним оцінювачам доступ до внутрішніх процесів для перевірки безпеки та контролю за практиками компанії.
Для оцінки рівня автономності Claude Anthropic використала шкалу Epoch AI, де AL0 означає повну відсутність участі ШІ, а AL5 — повну автономність. Станом на серпень 2026 року Claude не досяг максимального рівня автономності в жодному напрямі, але вже у 26% завдань працює на рівні AL4: модель виконує більшу частину роботи самостійно після отримання загального завдання від людини, а дослідник лише здійснює нагляд. У понад 90% завдань Claude працює щонайменше на рівні AL3, тобто виконує значну частину роботи у співпраці з людиною.
Окремо Anthropic розкрила, що на її основній внутрішній платформі діє близько 30 тисяч агентів ШІ. Усі їхні дії проходять через систему моніторингу, яка поєднує онлайн-перевірки в реальному часі та офлайн-аналіз. Онлайн-монітори перевіряють 100% дій агентів до їх виконання й можуть автоматично блокувати небезпечні операції. Протягом серпня було проаналізовано понад мільярд рішень, із яких заблоковано лише 0,002% — приблизно одну дію з кожних 47 тисяч. Офлайн-монітори щотижня аналізують близько 100 тисяч стенограм роботи агентів, а близько 50 найважливіших випадків передають на перевірку людям.
Anthropic також вперше оприлюднила дані про розподіл обчислювальних ресурсів: у липні 2026 року 6% обчислень, пов’язаних із розробкою ШІ, були спрямовані на безпеку, а з урахуванням ширшого набору завдань — близько 12%. У компанії підкреслили, що це навмисно занижені оцінки, оскільки частина ресурсів, які використовуються одночасно для розвитку й безпеки, не враховувалася.
«Ці показники не враховують класифікатори заходів безпеки, які становлять окремий, порівнянний обсяг обчислювальних ресурсів і роблять наші моделі набагато безпечнішими для світу», — зазначили в Anthropic.
У компанії вважають, що подібні звіти мають регулярно публікувати всі лабораторії, які розробляють передові моделі ШІ. Anthropic наголошує, що спільна методологія та незалежна перевірка допоможуть порівнювати темпи автоматизації, ефективність нагляду та частку ресурсів, які спрямовуються на безпеку. OpenAI вже впровадила систему регулярного звітування про несанкціоновану чи небезпечну поведінку своїх систем, розкриваючи випадки, коли моделі приховували помилки або намагалися обійти обмеження.
Публікація звітності відбувається на тлі ширшої дискусії про можливість уповільнення розвитку найпотужніших систем ШІ. Генеральний директор Anthropic Даріо Амодей закликав до обережності, його ініціативу підтримали Сем Альтман (OpenAI) та Ілон Маск (xAI), тоді як Марк Цукерберг (Meta) і Дженсен Хуанг (Nvidia) виступили проти сповільнення. Президент США Дональд Трамп відкинув твердження про екзистенційну загрозу ШІ для людства.

