Meta PixelGa naar de hoofdinhoud
AlexisAlexis· AI-auteur, door mensen beoordeeld
5 min read
956 woorden

Runway Gen-4.5 Domineert AI Video Benchmarks: Wat betekent de 1.247 Elo Score

Runway Gen-4.5 staat bovenaan de Artificial Analysis benchmark met een ongekende Elo van 1.247, voorbij Google Veo 3.1 en OpenAI Sora 2. We ontleden wat dit model uitzonderlijk maakt en wat het betekent voor videocreators.

Runway Gen-4.5 Domineert AI Video Benchmarks: Wat betekent de 1.247 Elo Score

Klaar om je eigen AI-video’s te maken?

Sluit je aan bij duizenden makers die Bonega.ai gebruiken

Sinds de lancering in december 2025 heeft Runway Gen-4.5 de eerste plaats veroverd op de Artificial Analysis AI Video Arena benchmark. Met een Elo-score van 1.247 heeft Gen-4.5 niet alleen gewonnen, het heeft opnieuw bepaald wat we van AI-videogeneratie verwachten.

De Cijfers die Tellen

Toen Runway Gen-4.5 in december 2025 aankondigde, vroegen skeptici zich af of het kon concurreren met de massale onderzoeksbudgetten van Google en OpenAI. De Artificial Analysis benchmark antwoordde daarop duidelijk.

1.247
Runway Gen-4.5 Elo
1.226
Google Veo 3 Elo
1.206
OpenAI Sora 2 Pro Elo

Het Elo-ratingsysteem, ontleend aan schaken, biedt een relatieve maatstaf voor modelkwaliteit op basis van directe vergelijkingen. Een verschil van 21 punten tussen Runway en Veo 3 betekent dat Runway ongeveer 53% van de directe vergelijkingen wint. Tegen Sora 2 Pro groeit dat voordeel tot ongeveer 56%.

💡

Voor context over hoe Sora 2 in dit concurrentiële landschap past, zie onze uitgebreide vergelijking van Sora 2, Runway en Veo 3.

Waarom Gen-4.5 Uitblinkt: Fysieke Realisme

De benchmarkresultaten weerspiegelen Gen-4.5's doorbraak in wat Runway "fysieke coherentie" noemt. In tegenstelling tot eerdere modellen die af en toe video's produceerden waarin objecten door elkaar heen gingen of de zwaartekracht inconsistent was, handhaaft Gen-4.5 fysieke plausibiliteit over langere sequenties.

Het gaat niet om perfecte fysicasimulatie. Het gaat om intuïtieve juistheid. Wanneer water uit een glas wordt gegoten, stroomt het naar beneden. Wanneer een bal kaatst, heeft de baan zin. Deze schijnbaar eenvoudige vereisten bleken verrassend moeilijk voor eerdere generatiemodellen.

Sterke Punten van Gen-4.5

Fysieke coherentie over video's van 10+ seconden, consistent licht, nauwkeurige reflecties en toonaangevende bewegingskwaliteit.

Verbeterpunten

Langzamere generatietijden dan concurrenten, hoger prijsniveau en soms artefacten in complexe scènes met meerdere personages.

De Architectuur Achter de Score

Gen-4.5 is gebaseerd op diffusie transformator architecturen die videogeneratie sinds 2024 hebben gedomineerd. Maar Runway's implementatie bevat verschillende innovaties die bijdragen aan de benchmarkprestaties.

Temporele Aandacht op Schaal

Het model gebruikt een hiërarchisch aandachtsmechanisme dat consistentie tussen frames handhaaft terwijl het schaalt tot outputs van minuten lang. Eerdere modellen hadden moeite met "drift", waarbij karakteruiterlijking of scèneelementen geleidelijk in de loop der tijd zouden verschuiven. Gen-4.5 lost dit op via wat Runway "verankerde temporele aandacht" noemt.

Native Audio-integratie

Zoals zijn concurrenten genereert Gen-4.5 nu audio samen met video. Deze geïntegreerde aanpak, verkend in onze analyse van hoe native audio AI-video transformeert, elimineert de storende mismatches die eerdere workflows plagieden.

🎵

Audiovisuële Coherentie

Gen-4.5 genereert gesynchroniseerde audio met nauwkeurige omgevingsakoestiek, dialoogtiming en geluidseffecten die overeenkomen met scèneacties.

Benchmark Methodologie: Wat Wordt Gemeten

De Artificial Analysis benchmark gebruikt blinde vergelijkingen waarbij menselijke beoordelaars videoparen op meerdere dimensies beoordelen.

De benchmark evalueert modellen op meerdere dimensies, waaronder bewegingskwaliteit, visuele getrouwheid, promptnaleving, temporele coherentie en audiokwaliteit. Menselijke beoordelaars vergelijken gegenereerde video's in blinde tests, wat directe vergelijkingen oplevert die in het Elo-systeem voeden.

Deze multidimensionale scoring helpt verklaren waarom Runway de algemene ranglijst aanvoert, ondanks dat concurrenten individuele categorieën winnen. Google Veo 3 leidt in pure resolutie, terwijl Sora 2 vaak wint op creatieve interpretatie. Maar Gen-4.5's uitgebalanceerde excellentie over alle dimensies levert de hoogste samengestelde score op.

Wat Dit Voor Creators Betekent

Voor videoprofessionals tellen benchmarkscores minder dan praktische mogelijkheden. Hier ziet u hoe Gen-4.5's prestaties zich vertalen naar werkelijk gebruik.

Snelheid

Generatietijd

5-7 minuten voor een 10-secondenclip op 1080p, langzamer dan Sora 2 (2-3 minuten) maar sneller dan lokale open-source alternatieven.

Kwaliteit

Uitvoerresolutie

Native 4K-ondersteuning met Runway's upscaling-pipeline, gelijk aan Veo 3.1's professionele output.

Controle

Creatieve Tools

Image-to-video, motion brush, camerabediening en stijlverwijzingen bieden meer directieve controle dan enige concurrent.

De combinatie van creatieve controle en outputkwaliteit maakt Gen-4.5 bijzonder geschikt voor professionele workflows. Reclamebureaus, filmprevisualiseringsteams en contentstudio's hebben het aangenomen voor taken variërend van conceptvideo's tot social media-inhoud.

Het Concurrentiële Landschap in Februari 2026

Gen-4.5's benchmarkvoordeel betekent niet dat de concurrentie is gestopt met innoveren. De AI-videruimte beweegt snel en verschillende ontwikkelingen zouden de rankings kunnen verschuiven.

🔜

Google Veo 3.2

Geruchten voor Q2 2026, Google's volgende iteratie richt zich naar verluidt op langervormige narratieve coherentie en verbeterde karakterconsistentie over scènes.

💡

OpenAI Sora 3

Hoewel OpenAI Sora 3 niet heeft aangekondigd, suggereert het Disney-partnerschap grote mogelijkheden in ontwikkeling voor gegeneratie met gelicentieerde karakters.

🚀

Kling 3.0

Kuaishou's agressieve releaseschema zou een ander benchmarkcontender uit China voor halverwege het jaar kunnen brengen.

Beyond Benchmarks: Het Grotere Geheel

Cijfers als 1.247 Elo vertellen deel van het verhaal, maar vangen alles niet. AI-videogeneratie heeft een punt bereikt waar alle topmodellen opmerkelijke resultaten produceren. De verschillen liggen in specifieke use cases, prijsstelling en ecosysteemintegratie.

Runway's voordeel is niet alleen de benchmarkscore. Het zijn jaren werkstroomrefinement die Gen-4.5 een praktisch hulpmiddel maken in plaats van een technologiedemo. Functies als motion brush, nauwkeurige camerabediening en naadloze integratie met professionele bewerkingssoftware weerspiegelen een focus op hoe creators werkelijk werken.

💡

Voor een praktische gids voor het beste resultaat van elk AI-videohulpmiddel, zie onze uitgebreide prompt engineering gids.

Toekomstperspectief

De Elo-score van 1.247 markeert een mijlpaal, maar geen eindpunt. AI-videogeneratie blijft vooruitgang boeken in een tempo dat vandaag's benchmarks morgen's baselines maakt. Wat meer telt dan enige enkele score is de baan: modellen die fysica begrijpen, coherentie handhaven en creators intuïtieve controle geven.

Runway Gen-4.5 leidt die baan vandaag. Morgen brengt nieuwe uitdagers, nieuwe mogelijkheden en nieuwe benchmarks. Voor nu zijn de gegevens duidelijk: als je de meest capabele AI-videogeneratie nodig hebt, heeft Runway de eerste plaats verdiend.


Benchmarkgegevens afkomstig uit Artificial Analysis AI Video Arena, februari 2026. Elo-scores weerspiegelen de huidige ranglijst en kunnen veranderen als nieuwe modellen worden geëvalueerd.

Alexis
AlexisAI EngineerAI Author

AI-engineer uit Lausanne die diepgaand onderzoek combineert met praktische innovatie. Verdeelt zijn tijd tussen modelarchitecturen en alpiene bergtoppen.

View profile →

Beviel wat je las?

Zet je ideeën in enkele minuten om in AI-video’s met onbeperkte lengte.

Gerelateerde artikelen

Blijf ontdekken met deze gerelateerde berichten

Vond je dit artikel leuk?

Ontdek meer inzichten en blijf op de hoogte van onze nieuwste content.