Битва за генерацию видео с помощью ИИ в июле: более 20 миллиардов капитала влилось в сектор, кто выйдет в финал?

генерация видео с помощью ИИмировая модельSeedanceKling AIPixVerseфинансированиеединорогFlovaAIVidu
1 Несколько часов назадИсточник: blockweeks.com
Битва за генерацию видео с помощью ИИ в июле: более 20 миллиардов капитала влилось в сектор, кто выйдет в финал?

爱诗科技

Июль еще не закончился, а трек генерации AI-видео уже раскалился до предела.

С 3 по 23 июля, всего за 20 дней, 5 компаний одна за другой объявили о крупных раундах финансирования.

Keling AI
получил 3 миллиарда долларов, Shengshu Technology — 500 миллионов долларов, Aishi Technology — несколько сотен миллионов долларов в раунде C+, Zhixiang Future — 1,5 миллиарда юаней в раунде C, и даже новая компания FlovaAI, основанная менее года назад, получила 80 миллионов долларов в посевном раунде.

Общий объем финансирования первых четырех компаний, достигших статуса единорога, превышает 26,2 миллиарда юаней. То есть, деньги, влившиеся в июле 2026 года, больше, чем весь трек за последние два года (2024-2025) вместе взятые.

Почему все они сосредоточили финансирование в июле? Что произошло? Это вряд ли случайность.

Keling AI: историческое совместное инвестирование BAT, ARR вырос в 4 раза за год

3 июля

Keling AI
объявил о раунде A на сумму до 3 миллиардов долларов, с лид-инвесторами CPE Yuanfeng и Guofang Innovation, при участии 34 институциональных инвесторов — в списке инвесторов редко одновременно появились Tencent, Alibaba Cloud и Baidu. Источник Capital выступил финансовым консультантом.

Верхняя граница раунда A в 3 миллиарда долларов соответствует пост-инвестиционной оценке около 18 миллиардов долларов; на данный момент подписано около 19 миллиардов юаней.

Почему капитал осмелился дать такую цифру? Ответ — в отчете Kuaishou за первый квартал 2026 года, который дал рынку уверенность.

Согласно финансовому отчету Kuaishou за Q1 2026,

Keling AI
за один квартал получил выручку более 650 миллионов юаней, что на более чем 300% больше по сравнению с аналогичным периодом прошлого года. Годовой показатель дохода (ARR) взлетел с 100 миллионов долларов в марте 2025 года до почти 500 миллионов долларов в марте 2026 года, увеличившись в 4 раза по сравнению с прошлым годом.

Эта цифра является отрывом в треке AI-видео — кроме ByteDance Seedance, ни одна другая компания в Китае не достигла такого масштаба.

Доход Keling обеспечивается двумя движущими силами: API-вызовы корпоративных клиентов B2B + платная подписка для пользователей P2P. По состоянию на июнь 2026 года,

Keling AI
превысил 100 миллионов глобальных пользователей, а число корпоративных клиентов достигло почти 50 000. Например, Keling глубоко участвовал в создании виртуальных сцен и спецэффектов для популярного китайского исторического сериала «Годы мира», а также поддерживал генерацию сотен высококачественных кадров в голливудском сериале «Династия Давида».

Что касается продукта, в феврале этого года Keling запустил серию моделей 3.0, обеспечивающих генерацию видео длительностью до 15 секунд, контроль раскадровки, согласованность объектов и синхронный вывод аудио и видео.

Стоит отметить две детали. Во-первых, оценка была несколько снижена по сравнению с майскими слухами о 20 миллиардах долларов, ценообразование стало более прагматичным, и сделка прошла быстрее; во-вторых, в объявлении была заложена оговорка о выкупе — если Beijing Keling не проведет IPO до октября 2031 года, инвесторы имеют право потребовать выкупа по номиналу плюс 8% годовых простых процентов.

Выделение, финансирование, опционы для сотрудников, условия выкупа — этот набор действий четко указывает на то, что Keling готовится к независимому IPO.

Shengshu Technology: 500 миллионов долларов накануне IPO, от видеомоделей к «мировой модели»

6 июля Shengshu Technology объявила о раунде B+ на 500 миллионов долларов.

Но если посмотреть на временную шкалу, эта компания провела 3 раунда за 5 месяцев: в феврале раунд A+ на более 600 миллионов юаней (лид-инвесторы Zhongguancun Science City и Xinglian Capital), в апреле раунд B на 2 миллиарда юаней (лид-инвестор Alibaba Cloud), плюс этот раунд в июле на 500 миллионов долларов — в сумме более 5 миллиардов юаней.

3 раунда за 5 месяцев — этот темп говорит об одном: капитал спешит сесть на поезд. Почему так срочно?

В конце марта этого года Shengshu Technology завершила акционирование — это стандартный шаг перед IPO. Рыночные источники сообщают, что компания может начать процесс листинга на Гонконгской фондовой бирже уже в первой половине года. Таким образом, капитал садится на поезд накануне IPO.

Основной продукт Shengshu Technology —

Vidu
, запущенный глобально в июле 2024 года. За три года он обновился до версии

Vidu
S1 — интерактивная модель в реальном времени, поддерживающая управление кадрами голосом и генерацию неограниченной длительности (от 1 минуты до 2 часов).

За весь 2025 год Shengshu Technology достигла более чем 10-кратного роста числа пользователей и доходов, сгенерировав в общей сложности более 400 миллионов видео; особенно впечатляет состав корпоративных клиентов B2B: в сфере рекламы и электронной коммерции — JD.com, Alibaba 1688, Amazon, Meituan, Focus Media, BlueFocus, L'Oréal, Anta; в сфере кино и анимации — Tencent Animation, Yuewen Group, CCTV Animation, iQiyi, Mango TV; в игровой сфере — Lilith, 37 Interactive Entertainment.

Shengshu Technology не удовлетворяется только генерацией видео и в этом году начала расширяться в направлении воплощенного интеллекта.

В апреле 2026 года Shengshu Technology официально выпустила универсальную мировую модель действий Motubrain, использующую технологический маршрут World Action Model (WAM), который объединяет восприятие, прогнозирование и действие в единую модель, наделяя роботов способностью «один мозг предвидит» и «один мозг многофункционален», а коммерческая версия MotuBrain вступила в промышленную верификацию.

Эта компания из университета Цинхуа, основанная всего 3 года назад, ускоренно эволюционирует из «компании видеомоделей» в «платформу универсальных мировых моделей». После получения 500 миллионов долларов средства будут в основном направлены на исследования и разработку «универсальной мировой модели».

Именно эту историю капитал действительно ценит.

Aishi Technology: единорог за три года, 150 миллионов глобальных пользователей

14 июля раунд C+ Aishi Technology возглавил Alibaba. Вместе с раундом C на 300 миллионов долларов, завершенным в марте (лид-инвестор CDH Investments, участие почти 20 компаний, включая China Ruyi и 37 Interactive Entertainment), общий объем финансирования раунда C достиг 2,98 миллиарда юаней, а пост-инвестиционная оценка превысила 2 миллиарда долларов.

Alibaba ранее возглавлял раунд B Aishi на 60 миллионов долларов в сентябре 2025 года, и теперь продолжает наращивать инвестиции в раунде C+. Ant Group также возглавил раунд A2 на сумму более 100 миллионов юаней еще в апреле 2024 года.

Постоянные инвестиции Alibaba Group в Aishi показывают, что она рассматривает Aishi как стратегическую точку в треке AI-видео.

По состоянию на март 2026 года глобальная пользовательская база Aishi Technology превысила 150 миллионов, ежемесячная активная аудитория — 15 миллионов, а годовой регулярный доход (ARR) достиг 40 миллионов долларов.

Интересно, что сооснователь Се Сюйчжан раскрыл, что стоимость обучения модели того же уровня в Aishi составляет лишь около 10% от стоимости конкурентов. Ключевой путь к такому преимуществу в стоимости — отбор‌высококачественных данных, сокращение бесполезных итераций обучения, а также использование оптимизированной архитектуры Diffusion Transformer для повышения эффективности использования ресурсов, снижения затрат на одно обучение и реализации повторного использования инженерного опыта.

В январе этого года Aishi выпустила

PixVerse
R1, заявив, что это первая в мире универсальная модель реального времени, поддерживающая 1080P. В отличие от традиционной "предварительно записанной" генерации видео, R1 реализует "динамическую генерацию в реальном времени" — пользователь может в любой момент вводить новые команды во время воспроизведения видео, и изображение плавно переходит между светом и камерой примерно за 0,5 секунды.

爱诗科技

Путь Aishi отличается от других игроков: другие соревнуются в качестве генерации, а она — в интерактивных возможностях. Всего через неделю после выпуска R1 China Ruyi объявила о стратегическом сотрудничестве с Aishi и инвестировала 14,2 миллиона долларов.

А в последнем раунде C+ цель финансирования четко указана: для базовой модели генерации видео, модели реального времени и глобального роста.

ZhiXiang Future: новый единорог, альтернативный подход "модель + агент + оборудование"

ZhiXiang Future — "новый единорог" в этом списке: после раунда C на 1,5 миллиарда юаней оценка после инвестиций превысила 1 миллиард долларов. Основатель Мэй Тао — иностранный академик Канадской инженерной академии, бывший вице-президент JD.com.

Эта компания за последние три месяца провела три раунда финансирования на общую сумму более 2,1 миллиарда юаней.

23 июля ZhiXiang Future объявила о раунде C на 1,5 миллиарда юаней, возглавляемом Фондом социального обеспечения, Фондом возрождения промышленности Сычуани и ICBC Investment, с участием Shanghai Film New Vision Fund, Huace Film & TV и других кинематографических капиталов, а также 18 институциональных инвесторов — комбинация государственных долгосрочных средств, местного государственного капитала и промышленного капитала, что редко встречается в сфере AI-видео.

Еще в мае 2024 года ZhiXiang запустила первую в мире открытую модель DiT для генерации видео, а на недавно завершившейся WAIC 2026 представила мультимодального творческого агента vivago R1, ориентированного на бесконечную генерацию и редактирование видео.

В настоящее время ее продукты охватывают более 100 стран, обслуживая более 50 миллионов пользователей и 40 тысяч корпоративных клиентов. Выручка за весь 2025 год превысила 100 миллионов юаней, а выручка за первый квартал 2026 года уже превысила прошлогоднюю. Мэй Тао заявил на Цепной выставке 2026 года, что из-за высоких затрат на предварительное обучение больших моделей компания ожидает достижения ежемесячной безубыточности к 2029 году.

Мэй Тао также сказал прямо: "Мы не конкурируем с ByteDance в базовых возможностях, мы занимаемся коммерческим маркетингом и профессиональным кинопроизводством."

Путь ZhiXiang ясен: избегать прямого столкновения с крупными компаниями и углубляться в вертикальные сценарии. Сначала она создает пользовательскую базу с помощью моделей изображений, а затем переходит к видео и мировым моделям.

FlovaAI: 80 миллионов долларов в посевном раунде, третий старт Го Ле

Основатель FlovaAI Го Ле — имя, которое нельзя обойти в истории мобильного интернета Китая. В 2013 году Го Ле создал Facemeng, затем FaceU, а в 2018 году команда была приобретена ByteDance за 300 миллионов долларов. После этого он участвовал в инкубации Qingyan Camera,

Xingtu
,

Jianying
— да,

Jianying
был создан при его участии.

В 2025 году Го Ле снова стартовал, основав Shenzhen Yuzhou Technology, и в октябре запустил Flova.ai. Sequoia China, IDG и Sky9 Capital вложили в общей сложности более 80 миллионов долларов.

Дать 80 миллионов долларов на посевном раунде — инвесторы ставят не на продукт, а на самого Го Ле. Каждый его предыдущий потребительский инструмент становился феноменальным хитом.

爱诗科技

Flova — это AI-нативная платформа агентов для создания видео. Пользователь выражает творческие потребности через диалог, а агент выполняет весь процесс от написания сценария, дизайна персонажей, раскадровки до генерации изображений/видео/аудио и сборки временной шкалы монтажа.

В отличие от основных на рынке форматов холста, Flova разработала рабочую панель "раскадровки". Агент получает инструкции в диалоговом окне, процесс работы отображается на левой раскадровке, пользователь видит результат в центральной области предварительного просмотра и может в любой момент дважды щелкнуть для вмешательства и изменения.

Многие ранние пользователи отмечают, что главная особенность Flova — "память": после создания десятков серий она может запомнить определенную раскадровку из первой серии. Такая способность к долгосрочной контекстной памяти очень выделяется среди аналогичных продуктов.

На данном этапе Flova придерживается стратегии нулевой маржи. Го Ле говорит: "На этапе развития мы будем стараться работать с нулевой маржой." Команда не стремится к краткосрочной выручке, а больше关注 коэффициент полезного потребления: какая часть потребления токенов считается пользователями ценной, а какая — бесполезной тратой из-за недостатков продукта.

Почему все собрались в июле? Возможные причины

Теперь вернемся к главному вопросу: почему эти пять компаний одновременно провели интенсивные раунды финансирования в июле? Собрав всю информацию, я обнаружил четыре причины, которые создали резонанс.

Во-первых, "эффект всасывания" ByteDance Seedance заставляет всех ускориться.

После запуска ByteDance Seedance 2.0 в феврале этого года ежемесячная выручка превысила 1 миллиард юаней, проникновение в индустрию коротких сериалов составило около 95%, а по дневному потреблению токенов занято более 80% рынка.

Volcano Engine повысил цель по выручке MaaS на 2026 год с прошлогодних 1,5 миллиарда до 15 миллиардов юаней — десятикратный рост, почти полностью за счет одной модели Seedance. Более того, Seedance 2.1 скоро выйдет, ожидается улучшение эффекта еще на 20%, а цена дешевой версии снижена до 0,5 юаня за секунду.

Когда ByteDance атакует рынок с помощью "лидирующего отрыва в возможностях модели + ценовой войны", другим игрокам, если они не будут быстро привлекать деньги, накапливать вычислительные мощности и ускорять итерации, может не остаться места за столом.

Все ищут точку опоры для долгосрочного противостояния с ByteDance. Но подходы разные: Kling идет по пути платформенной мультимодальности, Shengshu — по пути технического гика, Aishi — по пути дифференциации в реальном времени, ZhiXiang — по пути углубления в вертикальные сценарии, FlovaAI — по пути агентских рабочих процессов.

Капитал вкладывается не в одну и ту же историю, а делает ставки на разные технологические пути и бизнес-модели.

Во-вторых, монетизация уже работает, и капитал видит пути выхода.

В прошлом году все еще обсуждали, «может ли AI-видео приносить деньги», а в этом году данные уже есть: годовой повторяющийся доход (ARR) Kling составляет почти 500 миллионов долларов, доход Shengshu в 2025 году вырос более чем в 10 раз, ARR Aishi — 40 миллионов долларов, а Seedance превысил 1 миллиард за месяц.

Реклама, электронная коммерция, короткие сериалы, игры, кино — платные сценарии AI-видео подтверждаются один за другим. Это состояние «видимого денежного потока» является прямым триггером для концентрации капитала.

В-третьих, трек эволюционировал от «генерации видео» к «мировой модели», нарратив обновился.

В первой половине этого года конкурентная ландшафт базовых больших моделей стал более концентрированным, средства первичного рынка начали искать следующее направление, и мультимодальная генерация с мировой моделью стали консенсусным выходом.

Обратите внимание на тренд: ни одна из четырех компаний, получивших крупное финансирование, не заявляет, что занимается только «генерацией видео». Kling говорит о All-in-One полномодальном творческом рабочем процессе, Shengshu — о «универсальной мировой модели» и воплощенном интеллекте, Aishi — о «реальной мировой модели» и интерактивных развлечениях, Zhixiang — о «нативной полномодальной мировой модели» и каузальном выводе.

Генерация видео — лишь вход, настоящий финал — мировая модель: AI-система, способная понимать, рассуждать и строить физический мир. Инвесторы смотрят не на рынок генерации видео в этом году, а на то, кто сможет вырваться вперед с мировой моделью через три года.

В-четвертых, окно IPO на Гонконгской фондовой бирже открыто, капитал спешит за «билетами».

В январе этого года акции Zhipu и

MiniMax
после листинга на Гонконгской бирже значительно выросли, объем привлеченных средств через IPO в первом квартале превысил 100 миллиардов гонконгских долларов за 79 дней, установив исторический рекорд, а число компаний в очереди превысило 350.

Shengshu завершила реструктуризацию акций, ходят слухи об IPO; раздельное финансирование Kling с условиями обратного выкупа по сути также является прелюдией к листингу. Интенсивное финансирование на первичном рынке во многом готовит почву для входа на вторичный рынок.

Наконец, хочу сказать, что после этого июля трек AI-видео вступает в финальный раунд, и картина, вероятно, станет яснее: ведущие компании с большими средствами готовятся к выходу на биржу, компании среднего звена переоцениваются под нарратив мировой модели, а такие новые игроки, как Flova, пытаются обойти гонку моделей с помощью агентов и отхватить кусок пирога на уровне приложений.

Но за шумихой стоит проблема: деньги приходят быстро, но и сжигаются быстрее. Генерация видео — самый затратный по вычислительным ресурсам AI-сегмент, и 26 с лишним миллиардов звучат впечатляюще, но в пересчете на годовые счета за вычисления каждой компании может оказаться не так уж много.

Эта статья из публичного аккаунта WeChat «IT-апельсин» (ID: itjuzi521), автор: У Мэймэй