Lipiec 2026: Bitwa o AI wideo – ponad 20 miliardów juanów w grze, kto wejdzie do finału?

generowanie wideo AImodel świataSeedanceKling AIPixVersefinansowaniejednorożecFlovaAIVidu
1 Godzin temuŹródło: blockweeks.com
Lipiec 2026: Bitwa o AI wideo – ponad 20 miliardów juanów w grze, kto wejdzie do finału?

爱诗科技

Lipiec jeszcze się nie skończył, a rynek generowania wideo AI jest już rozgrzany do czerwoności.

Od 3 do 23 lipca, w ciągu zaledwie 20 dni, pięć firm ogłosiło duże rundy finansowania.

Keling AI
pozyskało 3 miliardy dolarów, Shengshu Technology 500 milionów dolarów, Aishi Technology w serii C+ kilkaset milionów dolarów, Zhixiang Future w serii C 1,5 miliarda juanów, a nawet nowa firma FlovaAI, założona niecały rok temu, zdobyła 80 milionów dolarów w rundzie seed.

Łączne finansowanie pierwszych czterech firm, które osiągnęły status jednorożca, przekracza 26,2 miliarda juanów. Oznacza to, że w lipcu 2026 roku napłynęło więcej pieniędzy niż w ciągu ostatnich dwóch lat (2024-2025) dla całego sektora razem wziętych.

Dlaczego wszyscy skoncentrowali się na finansowaniu w lipcu? Co się właściwie stało? To raczej nie może być przypadek.

Keling AI: Historyczne współinwestowanie BAT, ARR wzrosło czterokrotnie w ciągu roku

3 lipca,

Keling AI
ogłosiło górny limit podwyższenia kapitału w rundzie A w wysokości 3 miliardów dolarów, z CPE Yuanfeng i Guofang Innovation jako głównymi inwestorami, a 34 instytucje wzięły udział – na liście inwestorów rzadko spotykanie jednocześnie pojawiły się Tencent, Alibaba Cloud i Baidu. Guangyuan Capital pełniło rolę doradcy finansowego.

Górny limit podwyższenia kapitału w rundzie A wynoszący 3 miliardy dolarów odpowiada wycenie post-money na około 18 miliardów dolarów; obecnie podpisana część to około 19 miliardów juanów.

Dlaczego kapitał odważył się na taką kwotę? To raport kwartalny Kuaishou za pierwszy kwartał 2026 roku dał rynkowi pewność.

Raport finansowy Kuaishou za Q1 2026 ujawnił, że

Keling AI
osiągnął przychody w pojedynczym kwartale przekraczające 650 milionów juanów, co oznacza wzrost o ponad 300% rok do roku. Roczny wskaźnik przychodów (ARR) wzrósł z 100 milionów dolarów w marcu 2025 do prawie 500 milionów dolarów w marcu 2026, co oznacza czterokrotny wzrost rok do roku.

Ta liczba jest bezkonkurencyjna na rynku generowania wideo AI – poza ByteDance Seedance, żadna inna krajowa firma nie osiągnęła takiej skali.

Przychody Keling są napędzane dwoma kołami: wywołania API dla klientów biznesowych (B2B) oraz subskrypcje płatnych członków (P2C). Na koniec czerwca 2026 roku,

Keling AI
przekroczyło 100 milionów użytkowników na całym świecie, a liczba klientów biznesowych zbliżyła się do 50 tysięcy. Na przykład Keling głęboko uczestniczyło w tworzeniu wirtualnych scen i efektów specjalnych do popularnego chińskiego serialu historycznego „Rok Pokoju”, a w hollywoodzkim serialu „Dynastia Dawida” wsparło generowanie setek wysokiej jakości ujęć.

Jeśli chodzi o produkt, w lutym tego roku Keling uruchomiło modele serii 3.0, umożliwiające generowanie wideo o długości do 15 sekund, kontrolę storyboardu, spójność obiektów oraz synchronizację dźwięku i obrazu.

Warto zwrócić uwagę na dwa szczegóły. Po pierwsze, wycena została nieco obniżona w porównaniu z plotkowanym celem 20 miliardów dolarów w maju, co czyni transakcję bardziej pragmatyczną i przyspiesza jej realizację; po drugie, w ogłoszeniu zawarto klauzulę dotyczącą opcji sprzedaży – jeśli Beijing Keling nie przeprowadzi IPO przed październikiem 2031 roku, inwestorzy mają prawo żądać odkupu po cenie nominalnej powiększonej o 8% odsetek prostych rocznie.

Wydzielenie, finansowanie, opcje na akcje, klauzule odkupu – ta kombinacja działań wskazuje jasno: Keling przygotowuje się do niezależnego debiutu giełdowego.

Shengshu Technology: 500 milionów dolarów finansowania w przededniu IPO, od modeli wideo do „modelu świata”

6 lipca Shengshu Technology ogłosiło finansowanie w rundzie B+ w wysokości 500 milionów dolarów.

Ale jeśli spojrzeć na dłuższą oś czasu, firma ta przeprowadziła trzy rundy w ciągu 5 miesięcy: w lutym runda A+ o wartości ponad 600 milionów juanów (prowadzona przez Zhongguancun Science City i Xinglian Capital), w kwietniu runda B o wartości 2 miliardów juanów (prowadzona przez Alibaba Cloud), a w lipcu ta runda 500 milionów dolarów, co łącznie przekracza 5 miliardów juanów.

Trzy rundy w 5 miesięcy – to tempo mówi jedno: kapitał spieszy się, aby wsiąść do pociągu. Dlaczego tak pilnie?

Pod koniec marca tego roku Shengshu Technology zakończyło przekształcenie w spółkę akcyjną – to standardowy krok przed IPO. Wiadomości rynkowe mówią, że może rozpocząć proces IPO na giełdzie w Hongkongu już w pierwszej połowie roku. Dlatego kapitał spieszy się, aby wejść w przededniu IPO.

Głównym produktem Shengshu Technology jest

Vidu
, który został uruchomiony globalnie w lipcu 2024 roku i po trzech latach ewoluował do wersji

Vidu
S1 – model interaktywny w czasie rzeczywistym, obsługujący sterowanie klatkami głosowymi i generowanie o nieograniczonej długości (od 1 minuty do 2 godzin).

W całym 2025 roku Shengshu Technology osiągnęło ponad dziesięciokrotny wzrost liczby użytkowników i przychodów, generując łącznie ponad 400 milionów filmów; szczególnie imponująca jest lista klientów biznesowych: w reklamie i e-commerce JD.com, Alibaba 1688, Amazon, Meituan, Focus Media, BlueFocus, L'Oréal, Anta; w filmach i animacjach Tencent Animation, Yuewen Group, CCTV Animation, iQiyi, Mango TV; w grach Lilith Games, 37 Interactive Entertainment.

Shengshu Technology nie zadowala się tylko generowaniem wideo – w tym roku zaczęła rozszerzać działalność w kierunku inteligencji ucieleśnionej.

W kwietniu 2026 roku Shengshu Technology oficjalnie wydało ogólny model działania świata Motubrain , wykorzystujący technologię World Action Model (WAM) , która łączy percepcję, przewidywanie i działanie w jeden model, umożliwiając robotom „jeden mózg do przewidywania” i „jeden mózg do wielu zadań”, a komercyjna wersja MotuBrain weszła w fazę walidacji przemysłowej.

Ta firma z rodowodem Tsinghua, założona zaledwie 3 lata temu, przyspiesza ewolucję z „firmy modeli wideo” do „platformy ogólnych modeli świata”. Po otrzymaniu 500 milionów dolarów, środki zostaną przeznaczone głównie na badania i rozwój „ogólnego modelu świata”.

To jest właśnie historia, w którą kapitał naprawdę wierzy.

Aishi Technology: Jednorożec w trzy lata, 150 milionów użytkowników na całym świecie

14 lipca, seria C+ Aishi Technology była prowadzona przez Alibaba. Wraz z serią C o wartości 300 milionów dolarów zakończoną w marcu (prowadzoną przez CDH Investments, z udziałem prawie 20 inwestorów, w tym China Ruyi i 37 Interactive Entertainment), całkowite finansowanie serii C osiągnęło 2,98 miliarda juanów, a wycena post-money przekroczyła 2 miliardy dolarów.

Alibaba wcześniej prowadziło serię B Aishi o wartości 60 milionów dolarów we wrześniu 2025 roku, a teraz kontynuuje inwestycje w serii C+. Ant Group również prowadziło serię A2 o wartości ponad 100 milionów juanów w kwietniu 2024 roku.

Ciągłe inwestycje grupy Alibaba w Aishi pokazują, że traktuje ono Aishi jako strategiczny punkt na rynku generowania wideo AI.

Na koniec marca 2026 roku, Aishi Technology miało ponad 150 milionów użytkowników na całym świecie, 15 milionów aktywnych użytkowników miesięcznie, a roczny powtarzalny przychód (ARR) osiągnął 40 milionów dolarów.

Co ciekawe, współzałożyciel Xie Xuzhang ujawnił, że koszt szkolenia modeli na tym samym poziomie w Aishi wynosi tylko około 10% kosztów konkurencji. Kluczową ścieżką do tej przewagi kosztowej jest selekcja wysokiej jakości danych, redukcja nieefektywnych iteracji treningowych oraz wykorzystanie zoptymalizowanej architektury Diffusion Transformer w celu zwiększenia wykorzystania zasobów i obniżenia kosztów pojedynczego treningu, co osiąga się poprzez ponowne wykorzystanie doświadczeń inżynieryjnych.

W styczniu tego roku Aishi wydało

PixVerse
R1, twierdząc, że jest to pierwszy na świecie uniwersalny model świata rzeczywistego obsługujący 1080P. W przeciwieństwie do tradycyjnego generowania wideo „na żądanie”, R1 realizuje „dynamiczne generowanie w czasie rzeczywistym” – użytkownicy mogą w dowolnym momencie wprowadzać nowe polecenia podczas odtwarzania wideo, a obraz może płynnie przechodzić między światłem a kamerą w około 0,5 sekundy.

Aishi Technology

Ścieżka Aishi różni się od innych graczy: podczas gdy inni konkurują w jakości generowania, Aishi konkuruje w zdolnościach interakcyjnych. Zaledwie tydzień po premierze R1, China Ruyi ogłosiło strategiczną współpracę z Aishi i zainwestowało 14,2 miliona dolarów.

A najnowsza runda finansowania C+ ma jasno określony cel: wykorzystanie do podstawowego modelu generowania wideo, modelu świata rzeczywistego w czasie rzeczywistym oraz globalnego wzrostu.

Zhixiang Future: nowy jednorożec, nietypowe podejście „model + agent + sprzęt”

Zhixiang Future to „nowy jednorożec” na tej liście – po rundzie C o wartości 1,5 miliarda juanów, wycena po inwestycji przekroczyła 1 miliard dolarów. Założyciel Mei Tao jest zagranicznym członkiem Kanadyjskiej Akademii Inżynieryjnej i byłym wiceprezesem JD.com.

Firma ta w ciągu ostatnich trzech miesięcy przeprowadziła trzy rundy finansowania, łącznie ponad 2,1 miliarda juanów.

23 lipca Zhixiang Future ogłosiło rundę C o wartości 1,5 miliarda juanów, z udziałem China Social Security Fund, Sichuan Industrial Revitalization Fund, ICBC Investment, Shanghai Film New Vision Fund, Huace Film & TV oraz 18 innych instytucji – kombinacja krajowych funduszy długoterminowych, lokalnych kapitałów państwowych i kapitału przemysłowego, co jest rzadkością w sektorze AI wideo.

Zhixiang już w maju 2024 roku uruchomił pierwszy na świecie ogólnodostępny model DiT do generowania wideo, a na zakończonym właśnie WAIC 2026 zaprezentował multimodalnego agenta kreatywnego vivago R1, skoncentrowanego na generowaniu i edycji wideo o nieograniczonej długości.

Obecnie jego produkty są dostępne w ponad 100 krajach, obsługując ponad 50 milionów użytkowników i 40 000 klientów korporacyjnych. W 2025 roku przychody przekroczyły 100 milionów juanów, a w pierwszym kwartale 2026 roku przychody już przewyższyły ubiegłoroczne. Mei Tao podczas China International Supply Chain Expo w 2026 roku stwierdził, że ze względu na wysokie koszty wstępnego trenowania dużych modeli, firma spodziewa się osiągnąć miesięczny próg rentowności w 2029 roku.

Mei Tao powiedział wprost: „Nie konkurujemy z ByteDance w podstawowych możliwościach; zajmujemy się marketingiem komercyjnym i profesjonalną współpracą filmową.”

Ścieżka Zhixiang jest jasna: unikać bezpośredniej konfrontacji z gigantami i głęboko penetrować pionowe scenariusze. Najpierw buduje bazę użytkowników za pomocą modeli obrazu, a następnie ewoluuje w kierunku modeli wideo i świata.

FlovaAI: 80 milionów dolarów w rundzie seed, trzeci start Guo Lie

Założyciel FlovaAI, Guo Lie, to postać, której nie można pominąć w historii chińskiego internetu mobilnego. W 2013 roku stworzył FaceQ, później FaceU, a w 2018 roku zespół został przejęty przez ByteDance za 300 milionów dolarów. Następnie w ByteDance uczestniczył w inkubacji LightIn,

Xingtu
,

Jianying
– tak,

Jianying
to jego dzieło.

W 2025 roku Guo Lie ponownie wystartował, zakładając Shenzhen Yuzhou Technology, a w październiku uruchomił Flova.ai. Sequoia China, IDG i Sky9 Capital zainwestowały łącznie ponad 80 milionów dolarów.

Odważne 80 milionów dolarów w rundzie seed – inwestorzy stawiają nie na produkt, ale na samego Guo Lie. Każdy produkt konsumencki, który stworzył w przeszłości, stał się fenomenalnym hitem.

Aishi Technology

Flova to natywna platforma agentów do tworzenia wideo AI. Użytkownicy wyrażają potrzeby twórcze poprzez rozmowę, a agent wykonuje cały proces od scenariusza, projektowania postaci, storyboardu, po generowanie obrazów/wideo/audio i montaż osi czasu.

W przeciwieństwie do głównego nurtu interfejsów canvas, Flova zaprojektowało panel roboczy „storyboard”. Agent odbiera polecenia w oknie dialogowym, a proces pracy jest wyświetlany na lewym storyboardzie; użytkownik widzi wyniki bezpośrednio w środkowym podglądzie i może w każdej chwili kliknąć dwukrotnie, aby interweniować i modyfikować.

Wielu wczesnych użytkowników zgłasza, że największą cechą Flovy jest „pamięć” – po stworzeniu kilkunastu odcinków wciąż pamięta konkretny storyboard z pierwszego odcinka. Ta zdolność do długiego kontekstu jest wyjątkowa wśród podobnych produktów.

Obecnie Flova stosuje strategię zerowej marży. Guo Lie mówi: „W fazie rozwoju staramy się utrzymać zerową marżę.” Zespół nie spieszy się z dążeniem do krótkoterminowych przychodów, bardziej skupia się na efektywnym wskaźniku zużycia: ile z zużytych tokenów użytkownicy uznają za wartościowe, a ile to strata spowodowana niedoskonałościami produktu.

Dlaczego wszyscy tłoczą się w lipcu? Możliwe przyczyny

Wracając do głównego pytania: dlaczego te 5 firm jednocześnie intensywnie pozyskuje finansowanie w lipcu? Po złożeniu wszystkich informacji znalazłem cztery przyczyny, które tworzą rezonans.

Po pierwsze, „efekt ssania” ByteDance Seedance zmusza wszystkich do przyspieszenia.

Od premiery ByteDance Seedance 2.0 w lutym tego roku, miesięczne przychody przekroczyły 1 miliard juanów, penetracja w branży krótkich filmów wynosi około 95%, a udział w rynku pod względem dziennego zużycia tokenów przekracza 80%.

Volcano Engine podniósł cel przychodów MaaS na 2026 rok z 1,5 miliarda do 15 miliardów juanów – 10-krotny wzrost, prawie w całości oparty na jednym modelu Seedance. Co więcej, Seedance 2.1 ma wkrótce zostać wydany, z oczekiwaną poprawą wydajności o 20%, a cena wersji low-end spadnie do 0,5 juana za sekundę.

Gdy ByteDance atakuje rynek podwójną strategią „przewagi modelowej + wojny cenowej”, inni gracze, jeśli szybko nie zdobędą pieniędzy, nie zgromadzą mocy obliczeniowej i nie przyspieszą iteracji, mogą nawet stracić prawo do pozostania przy stole.

Wszyscy szukają punktu oparcia do długoterminowej walki z ByteDance. Ale strategie są różne: Kling idzie w kierunku platformy multimodalnej, Shengshu w kierunku technicznego geeka, Aishi w kierunku interakcji w czasie rzeczywistym, Zhixiang w kierunku głębokiej penetracji pionowej, a FlovaAI w kierunku przepływu pracy agenta.

Kapitał nie inwestuje w tę samą historię, ale stawia na różne ścieżki technologiczne i modele biznesowe.

Po drugie, komercjalizacja już działa, a kapitał widzi ścieżkę wyjścia.

W zeszłym roku wszyscy dyskutowali, czy „AI wideo może zarabiać pieniądze”, a w tym roku dane już są: ARR Keling wynosi prawie 500 milionów dolarów, przychody Shengshu w 2025 roku wzrosły ponad 10-krotnie, ARR Aishi to 40 milionów dolarów, a Seedance przekroczył 1 miliard miesięcznie.

Reklamy, e-commerce, krótkie filmy, gry, kino – scenariusze płatności za AI wideo są po kolei weryfikowane. Ten stan „widocznych przepływów pieniężnych” jest bezpośrednim wyzwalaczem koncentracji kapitału.

Po trzecie, ścieżka ewoluuje z „generowania wideo” do „modelu świata”, narracja się zmienia.

W pierwszej połowie tego roku konkurencja w zakresie podstawowych modeli dużych zaczęła się koncentrować, a kapitał pierwotny zaczął szukać kierunku na następny etap. Generowanie multimodalne i modele świata stały się konsensusem wyjścia.

Zwróć uwagę na trend: żadna z 4 firm, które otrzymały ogromne finansowanie, nie twierdzi, że zajmuje się tylko „generowaniem wideo”. Keling mówi o wszechstronnym przepływie pracy All-in-One, Shengshu o „uniwersalnym modelu świata” i ucieleśnionej inteligencji, Aishi o „modelu świata w czasie rzeczywistym” i rozrywce interaktywnej, a Zhixiang o „natywnym multimodalnym modelu świata” i wnioskowaniu przyczynowym.

Generowanie wideo to tylko wejście, prawdziwym celem jest model świata – system AI, który potrafi rozumieć, wnioskować i budować fizyczny świat. Inwestorzy nie patrzą na tegoroczny rynek generowania wideo, ale na to, kto za trzy lata będzie liderem w modelach świata.

Po czwarte, okno IPO na giełdzie w Hongkongu jest otwarte, kapitał walczy o „bilety”.

W styczniu tego roku, po wejściu Zhipu i

MiniMax
na giełdę w Hongkongu, ich ceny akcji znacznie wzrosły. W pierwszym kwartale kwota pozyskana z IPO na giełdzie w Hongkongu przekroczyła 100 miliardów HKD w 79 dni, bijąc historyczny rekord, a liczba firm oczekujących w kolejce przekroczyła 350.

Shengshu zakończył restrukturyzację akcji, krążą plotki o IPO; wydzielenie finansowania Keling z klauzulą odkupu to w istocie preludium do debiutu giełdowego. Intensywne finansowanie na rynku pierwotnym w dużej mierze przygotowuje grunt pod wejście na rynek wtórny.

Na koniec chcę powiedzieć, że po tym lipcu ścieżka AI wideo wchodzi w fazę finałową, a układ prawdopodobnie stanie się wyraźniejszy: czołowe firmy z dużymi środkami pędzą do debiutu giełdowego, firmy średniego szczebla są przewartościowywane przez narrację modelu świata, a nowi gracze, tacy jak Flova, próbują ominąć wyścig zbrojeń modeli za pomocą Agentów i odciąć kawałek tortu z warstwy aplikacji.

Jednak problemem za tym zgiełkiem jest to, że pieniądze przychodzą szybko, ale jeszcze szybciej są spalane. Generowanie wideo to kategoria AI o największym zużyciu mocy obliczeniowej. Ponad 26 miliardów brzmi imponująco, ale rozłożone na roczne rachunki za moc obliczeniową poszczególnych firm, może nie być zbyt dużo.

Ten artykuł pochodzi z publicznego konta WeChat „IT Orange” (ID: itjuzi521), autor: Wu Meimei