
Runway Gen-4.5 — разбор всех бенчмарков нового лидера text-to-video
Runway выпустила Gen-4.5 и сразу заняла первое место на главном публичном лидерборде text-to-video моделей. Но независимые лаборатории и практикующие ревизоры дают куда более противоречивую картину. Разбираемся по цифрам — где Gen-4.5 реально номер один, а где её обходят конкуренты.
Что нового в Runway Gen-4.5 и почему все о ней спорят
Runway Gen-4.5 сейчас — одна из сильнейших text-to-video моделей по публичным бенчмаркам. Лучше всего подтверждены её сильные стороны, а именно качество движения, следование промпту и визуальная достоверность. Но при этом она всё ещё показывает типичные слабости видео-ИИ — проблемы с причинно-следственными связями, постоянством объектов и «слишком успешными» действиями.
Независимые тесты в целом подтверждают топ-уровень модели, но не все согласны, что это «безусловный №1», и некоторые практикующие лаборатории ставят её ниже в реальных рейтингах
Давайте начнем разбираться, взглянув на бенчмарки, сторонние обзоры и количественные тесты.
Главный бенчмарк Runway Gen-4.5 — Artificial Analysis Text-to-Video
Основное «доказательство», на которое опирается Runway, — это бенчмарк Artificial Analysis Text-to-Video,работающий как Elo-арена между десятками моделей.
Что показывают цифры

Если смотреть по открытым данным, Runway Gen-4.5 сейчас действительно выглядит одним из главных лидеровсреди ИИ-моделей для генерации видео. На исследовательской странице Runway говорится, что модель набрала 1247 Elo и заняла первое место в бенчмарке Artificial Analysis Text-to-Video, обойдя все остальные модели. То же самое компания повторила в своём официальном аккаунте X, где заявила, что Gen-4.5 превзошла другие ИИ-видеомодели.
AIcerts пишет примерно то же самое, модель стартовала с Elo около 1247 и обошла Veo 3 с 1226 баллами и Sora 2Pro с 1206. Независимые комментаторы в X также обращают внимание на этот лидерборд и отдельно подчёркивают разрыв в 21 пункт между Gen-4.5 и Veo 3. Проще говоря, по этим данным Runway сейчас не просто догнала конкурентов, а вышла на первое место.
По данным этих источников, бенчмарк Artificial Analysis оценивает качество движения, следование промпту и визуальную достоверность по тысячам генераций, и Gen-4.5 находится на вершине совокупного рейтинга на конец 2025 года.
Тест на реалистичность Runway Gen-4.5 — The Turing Reel




Источник: Тест The Turing Reel
У Runway есть собственный формальный тест в стиле Тьюринга, который проверяет, могут ли люди отличить сгенерированное видео от реальной съёмки. В эксперименте The Turing Reel ролики Gen-4.5 смешали с настоящими видео и показали 1043 участникам. После этого людей попросили определить, где реальное видео, а где генерация.
Результат получился сильным для Runway. Только 9,5% участников, то есть 99 человек, смогли показатьстатистически значимую точность распознавания. Для этого нужно было дать не меньше 15 правильных ответов из 20 при p<0,05. Общая точность распознавания составила 57,1%, что Runway описывает как результат лишь немного выше случайного угадывания.
Важно понимать, что это не прямое сравнение Gen-4.5 с Veo, Sora или Kling. Это другой тип проверки, но он показывает главное, многие люди в слепом тесте не могут надёжно отличить видео Gen-4.5 от реальной съёмки. Поэтому аргумент Runway о высокой реалистичности модели выглядит убедительно, особенно в части визуальной достоверности, движения и следования промпту.
Технические улучшения Runway Gen-4.5 относительно Gen-4
Из анонса Runway и сторонних резюме видно, что Runway позиционирует Gen-4.5 как «новую foundation-модель для моделирования мира» с прогрессом в эффективности предобучения и техниках посттренинга
Заявлены три ключевых улучшения относительно Gen-4.
Лучшая физика и реализм движения. Объекты показывают «реалистичный вес и движение»
Точнее следование промпту. Входные описания выполняются надёжнее.
Стабильнее визуальное качество во времени. Детали вроде волос, текстуры ткани и отражений остаются согласованными между кадрами.
Сторонние обзоры в целом подтверждают тот же нарратив, который продвигает Runway. The Decoder, CNBC и CometAPI пишут, что Gen-4.5 стала лучше реагировать на промпты, стабильнее держит визуальную консистентность, точнее передаёт движение и работу камеры, а также увереннее справляется с физическими взаимодействиями между объектами.
Но здесь важно отделять консенсус формулировок от независимого доказательства. Эти оценки хорошо совпадают с тем, что заявляет сама Runway, и выглядят логично на фоне высокого результата Gen-4.5 в Artificial Analysis Text-to-Video. Если модель действительно сильнее в движении, следовании промпту и визуальной достоверности, такие улучшения должны проявляться именно так.
При этом основа этих заявлений всё ещё во многом вендорская. Речь не о независимых лабораторных измерениях с полностью внешней методологией, а о данных Runway и обзорах, которые их пересказывают или интерпретируют. Поэтому корректный вывод такой: Gen-4.5 выглядит как заметный шаг вперёд и, вероятно, один из лидеров рынка, но окончательно подтвердить масштаб отрыва смогут только независимые сравнительные тесты.
Если смотреть только на Artificial Analysis, Runway Gen-4.5 выглядит как очевидный лидер. Модель стартовала с результатом около 1247 Elo и обошла Veo 3, Kling 2.x и Sora 2 Pro. Runway также подкрепляет это собственным тестом The Turing Reel, где люди в слепом сравнении лишь немного лучше случайного угадывания отличали видео Gen-4.5 от реальной съёмки.
Но если перейти от одного лидерборда к практическим и смешанным бенчмаркам, картина становится менее однозначной. Gen-4.5 остаётся моделью топ-уровня, но уже не выглядит безусловным победителем во всех сценариях.
Где Runway Gen-4.5 проигрывает
VibeDex даёт Gen-4.5 оценку 4.50 из 5 и ставит её на 4-е место в своём рейтинге. Это всё ещё высокий результат, но не первое место. При этом VibeDex отдельно подчёркивает сильную физику движения и хорошее следование промпту, но указывает на слабое соотношение цены и результата. В их тесте одно видео стоило около $1.21, что на 73% дороже Seedance 2.0 при более низкой общей оценке.

Вывод здесь простой. По качеству Gen-4.5 находится в верхнем сегменте, но если учитывать цену, она уже не выглядит самым рациональным выбором для массового продакшена или большого числа итераций.
Что говорят практические тесты
Vantaige подтверждает, что Gen-4.5 стала заметным шагом вперёд относительно Gen-4. Особенно в физике, следовании промпту и выразительной анимации персонажей. Один из самых конкретных тестов касается консистентности лица персонажа. Из 30 сгенерированных последовательностей около 70% сохранили идеальную консистентность лица между разными ракурсами внутри одного клипа, и только 7% полностью провалились.
Источник: Рейтинг VantAige
Это важный практический плюс. Для коротких сцен, где нужно удержать одного персонажа, Gen-4.5 действительно выглядит сильной. Особенно если сравнивать её с потребительскими инструментами, где лицо, одежда и детали персонажа часто «плывут» от кадра к кадру.
Почему не все считают Runway Gen-4.5 лучшей
Самый заметный контраргумент даёт Curious Refuge Labs. В раннем сравнении Gen-4.5 с Kling 2.6 они заявляют, что не считают Runway близкой к званию лучшей ИИ-видеомодели на рынке. В их предварительном внутреннем рейтинге Runway Gen-4.5 находится примерно на 8-м месте, немного выше LTX2.
Это не такой формальный численный бенчмарк, как Artificial Analysis, но его нельзя игнорировать. Curious Refuge оценивает модели с точки зрения практического кинематографического результата, а не только по общим метрикам реалистичности, движения и следования промпту. И в таком сценарии Runway не всегда оказывается лучшим выбором.
Известные слабости Runway Gen-4.5
Даже благосклонные обзоры признают, что Gen-4.5 не решила фундаментальные проблемы генеративного видео. Модель всё ещё может ошибаться в причинно-следственных связях. Например, дверь может начать открываться до того, как персонаж нажал на ручку. Объекты могут исчезать после кратковременного перекрытия. Также сохраняется так называемый success bias, когда действия в видео удаются слишком часто и слишком идеально. Например, плохо нацеленный выстрел всё равно попадает в цель.
То есть Gen-4.5 действительно продвигает реализм, движение и связность вперёд, но она не обладает полноценным физическим пониманием мира. Это ограничение характерно не только для Runway, а для всего текущего поколения text-to-video моделей.
Цена и формат использования
Ещё один важный фактор — стоимость. Gen-4.5 в первую очередь ориентирована на text-to-video. В отличие от Gen-4, которая сильнее ассоциировалась с image-to-video, новая модель делает акцент именно на генерации видео из текста.
На старте Gen-4.5 не генерирует нативный звук, поэтому аудио нужно добавлять отдельно. Это усложняет рабочий процесс, если нужен готовый ролик, а не только видеоряд.
По данным DataCamp, генерация стоит 25 кредитов за секунду видео. Самый дешёвый план с 625 кредитами даёт всего около 25 секунд видео. Для экспериментов этого достаточно, но для продакшена, где на один удачный клип может понадобиться много попыток, стоимость быстро растёт.
Итоговая оценка
Самые сильные аргументы в пользу Runway Gen-4.5 выглядят так.
Gen-4.5 показала один из лучших результатов на Artificial Analysis Text-to-Video и на старте занимала первое место с результатом около 1247 Elo. Тест The Turing Reel показал, что многие люди не могут надёжно отличить её видео от реальной съёмки. Сторонние обзоры также регулярно отмечают сильное движение, хорошее следование промпту, визуальную достоверность и заметный прогресс в консистентности персонажей.
Но есть и ограничения.
VibeDex ставит Gen-4.5 только на 4-е место в смешанном рейтинге качества и цены. Curious Refuge оценивает её ещё ниже с точки зрения кинематографического результата. Даже позитивные обзоры признают проблемы с причинностью, постоянством объектов и реалистичностью сложных действий. А стоимость генерации делает модель не самой выгодной, если нужно много итераций.
Поэтому корректный вывод такой. Runway Gen-4.5 — одна из самых сильных видео-моделей на рынке и, по отдельным публичным метрикам, лидер. Но она не является универсально лучшей моделью для всех задач. Для реалистичного движения и физики она может быть отличным выбором. Для кинематографических сцен, конкретного визуального стиля или лучшего соотношения цены и результата конкуренты вроде Kling, Veo, Sora или Seedance могут оказаться практичнее.
Как начать пользоваться Gen-4.5 прямо сейчас
Главный вывод в том, что одной «лучшей» видео-модели для всех сценариев пока нет. Runway Gen-4.5 сильна в реалистичном движении, физике и визуальной достоверности. Veo и Sora могут быть полезны для альтернативных стилей и других типов сцен. Kling часто выбирают для кинематографичных кадров. Seedance может быть выгоднее по цене.
Покупать отдельную подписку на каждый сервис дорого и неудобно. Поэтому мы собрали топовые видео-нейросети в одном месте по одной подписке в нашем сервисе Unitool.ai.
Runway Gen-4.5, Veo, Sora, Kling и другие модели доступны в одном окне, без отдельных регистраций и оплат.
Платите один раз и выбирайте подходящую модель под конкретную задачу. Попробуйте сервис и больше не придётся выбирать одну модель в ущерб другим сценариям.