Компания Fal представила H3 Max Live — систему генерации видео, которая впервые позволяет создавать видео быстрее, чем длится его воспроизведение. Как сообщает Latent Space, новый сервис основан на модели искусственного интеллекта H3 от Minimax, которую Fal дообучила и оптимизировала для собственного движка, достигнув скорости, которая примерно в 35 раз превышает показатели официального API модели.

Ранее даже самые современные модели, включая consistency models, не могли генерировать видео в реальном времени — создание ролика занимало больше времени, чем его просмотр. Основной проблемой оставалась недостаточная скорость генерации кадров для комфортного восприятия человеком.

H3 Max Live поддерживает бесконечную генерацию видео в прямом эфире: пользователи могут влиять на развитие сцен через чат, используя команду !prompt, и видеть результат через несколько секунд. Исследователь искусственного интеллекта Итан Моллик одним из первых обратил внимание на эту технологию, отметив в соцсети X:

"Перейдена граница в сфере видео, созданного с помощью ИИ: в моих экспериментах, проведённых исключительно через веб-интерфейс, H3 Max теперь может создавать видео достаточно высокого качества за время, короче того, что понадобится вам, чтобы его просмотреть".

После этого Fal подключила модель к трансляции на Twitch, где она генерировала непрерывный поток видео. Инженер компании Рехан Шейх назвал проект "бесконечным межпространственным телевидением", в котором каждая новая сцена создаётся в реальном времени. Основатель levels.io создал на основе этой технологии проект Infinite Slop — интерактивную трансляцию, где сообщения пользователей в чате становятся основой для следующих видеофрагментов.

Однако эксперимент столкнулся с ограничениями: Twitch и YouTube быстро заблокировали стрим, после чего Fal запустила собственный сервис Fal.live для непрерывных трансляций с взаимодействием через чат. Качество контента пока остаётся неоднородным — видео часто выглядит хаотичным, с фрагментарным сюжетом и разным качеством изображения. Тем не менее сама возможность генерировать видео быстрее времени его просмотра открывает новый этап развития генеративных моделей.

На фоне распространения гиперреалистичных фото, видео и виртуальных инфлюенсеров The Wall Street Journal опубликовал советы экспертов по цифровой криминалистике по распознаванию ИИ-контента. Специалисты предупреждают, что наплыв качественных дипфейков усложняет объективное восприятие реальности и советуют пользоваться базовыми методами фактчекинга.