Нью-йоркський стартап Pangram, що спеціалізується на виявленні контенту, створеного штучним інтелектом, залучив $9 млн інвестицій для розвитку своїх технологій. Компанія представила нову модель виявлення AI-текстів Pangram 4 та модель для виявлення AI-зображень Pangram Image.
Раунд фінансування очолив Menlo Ventures за участі Haystack, ScOp, Script Capital і Cadenza. За словами засновників Макса Сперо та Бредлі Емі, нова модель текстового детектора має точність понад 99% у виявленні текстів, створених або відредагованих штучним інтелектом, а також здатна розпізнавати програми, що «очищують» AI-контент під людський стиль. Модель для зображень наразі доступна у вигляді дослідницького прев’ю, а ширше розповсюдження планується найближчими тижнями.
Після появи ChatGPT інтернет наповнився ботами, AI-генерованим SEO-контентом і дезінформацією, зокрема, за словами Сперо, «LLM-орієнтованими російськими кампаніями дезінформації та кампаніями, що впливають з ОАЕ на Twitter». Він підкреслює важливість розуміння, чи текст створений людиною, адже це впливає на довіру до інформації: "Чи потрібно мені ставитися до тексту скептично через можливі хибні факти, чи це добре досліджена журналістська робота".
Технологія Pangram базується на великій моделі машинного навчання, навченій на десятках мільйонів людських документів та їх «синтетичних дзеркалах» — текстах з аналогічною темою, довжиною і стилем, але створених AI. Це дозволяє моделі виявляти стилістичні відмінності та послідовні вибори штучного інтелекту без використання метаданих або водяних знаків.
Pangram не лише визначає повністю AI-згенерований текст, а й розрізняє ступені AI-допомоги, наприклад, коли автор сам пише текст, а потім редагує його за допомогою AI. Сперо вважає, що використання AI може бути прийнятним за умови прозорого повідомлення про це.
Зараз AI-контент стає звичним явищем, що викликає як сміх, так і серйозні наслідки. Наприклад, канадського політика висміяли за промову, прочитану з AI-підказки, а деякі юристи ризикують санкціями через фальшиві посилання, створені ChatGPT. Через це інституції вводять нові правила: архів arXiv заборонив на рік подавати роботи, якщо автори не перевірили AI-генерований текст на помилки.
Pangram конкурує з іншими сервісами, такими як Winston AI, Originality.ai, Copyleaks і GPTZero, які також розробляють власні детектори AI-контенту. Користувачі можуть підписатися на Pangram за $20 на місяць або встановити розширення для Chrome, яке в реальному часі позначає пости на X, LinkedIn, Substack, Reddit і Medium, а також показує відсоток AI- та людського контенту на екрані.
Компанія також пропонує API, який інтегрували, зокрема, Substack, щоб читачі бачили, які автори використовують AI. Серед клієнтів також Quora, навчальні заклади, видавці, агенції та рекрутери.
За словами Сперо, модель Pangram помилково позначає AI-контентом приблизно один із 10 тисяч людських документів. Тестування показало, що модель надійно виявляє повністю AI-згенеровані тексти, а також розпізнає AI-допомогу при редагуванні. Водночас іноді вона помилково відносить людські речення до AI. Модель для зображень виявляє AI-картинки за статистичними відмінностями на рівні пікселів, включно з AI-зображеннями, вставленими у реальні фото.
Сперо наголошує, що технологія не має на меті полювання на користувачів AI, але потрібен механізм протидії «сміттю» AI-контенту. "Майбутнє, яке я бачу, — це постійне зростання AI-контенту. Якщо не віддавати перевагу людському контенту, AI просто витіснить будь-який людський сигнал", — зазначив він.

