Meta PixelSaltar al contenido principal
AlexisAlexis· Autora de IA, revisada por humanos
7 min read
1235 palabras

Runway Gen-4.5 Domina los Benchmarks de Video IA: Qué Significa la Puntuación Elo de 1 247

Runway Gen-4.5 encabeza el benchmark de Artificial Analysis con un Elo sin precedentes de 1 247, superando a Google Veo 3.1 y OpenAI Sora 2. Desglosamos qué hace que este modelo sea excepcional y qué significa para los creadores de video.

Runway Gen-4.5 Domina los Benchmarks de Video IA: Qué Significa la Puntuación Elo de 1 247

¿Listo para crear tus propios vídeos con IA?

Únete a miles de creadores que usan Bonega.ai

Desde su lanzamiento en diciembre de 2025, Runway Gen-4.5 ha reclamado el primer lugar en el benchmark Artificial Analysis AI Video Arena. Con una puntuación Elo de 1 247, Gen-4.5 no solo ganó, redefinió lo que esperamos de la generación de video IA.

Los Números que Importan

Cuando Runway anunció Gen-4.5 en diciembre de 2025, los escépticos se preguntaban si podía competir con los enormes presupuestos de investigación de Google y OpenAI. El benchmark de Artificial Analysis respondió de manera definitiva.

1 247
Elo Runway Gen-4.5
1 226
Elo Google Veo 3
1 206
Elo OpenAI Sora 2 Pro

El sistema de calificación Elo, tomado del ajedrez, proporciona una medida relativa de la calidad del modelo basada en comparaciones directas. Una brecha de 21 puntos entre Runway y Veo 3 se traduce en que Runway gana aproximadamente el 53% de las comparaciones directas. Contra Sora 2 Pro, esa ventaja crece a alrededor del 56%.

💡

Para conocer cómo Sora 2 se ajusta a este panorama competitivo, consulta nuestra comparación completa de Sora 2, Runway y Veo 3.

Por Qué Gen-4.5 Destaca: Realismo Físico

Los resultados del benchmark reflejan el avance de Gen-4.5 en lo que Runway llama "coherencia física". A diferencia de modelos anteriores que ocasionalmente producían videos donde los objetos se atravesaban o la gravedad se comportaba de manera inconsistente, Gen-4.5 mantiene plausibilidad física en secuencias más largas.

No se trata de una simulación física perfecta. Se trata de corrección intuitiva. Cuando se vierte agua de un vaso, fluye hacia abajo. Cuando rebota una pelota, la trayectoria tiene sentido. Estos requisitos aparentemente simples resultaron sorprendentemente difíciles para los modelos de generaciones anteriores.

Fortalezas de Gen-4.5

Coherencia física en videos de 10+ segundos, iluminación consistente, reflejos precisos y calidad de movimiento líder en la industria.

Áreas de Mejora

Tiempos de generación más lentos que la competencia, nivel de precios más alto y artefactos ocasionales en escenas complejas de múltiples personajes.

La Arquitectura Detrás de la Puntuación

Gen-4.5 se construye sobre arquitecturas de transformadores de difusión que han dominado la generación de video desde 2024. Pero la implementación de Runway incluye varias innovaciones que contribuyen a su desempeño en benchmarks.

Atención Temporal a Escala

El modelo utiliza un mecanismo de atención jerárquica que mantiene la consistencia entre fotogramas mientras se amplía a salidas de duración de minutos. Los modelos anteriores tenían dificultades con la "desviación", donde las apariencias de personajes o elementos de la escena se desplazaban gradualmente con el tiempo. Gen-4.5 aborda esto a través de lo que Runway describe como "atención temporal anclada".

Integración de Audio Nativa

Como sus competidores, Gen-4.5 ahora genera audio junto con video. Este enfoque unificado, explorado en nuestro análisis de cómo el audio nativo transforma el video IA, elimina los desajustes alarmantes que afectaron los flujos de trabajo anteriores.

🎵

Coherencia Audiovisual

Gen-4.5 genera audio sincronizado con acústica ambiental precisa, sincronización de diálogos y efectos de sonido que coinciden con las acciones en pantalla.

Metodología de Benchmark: Qué Se Mide

El benchmark de Artificial Analysis utiliza comparaciones ciegas donde los evaluadores humanos califican pares de videos en múltiples dimensiones.

El benchmark evalúa modelos en múltiples dimensiones, incluida la calidad del movimiento, la fidelidad visual, la adherencia al indicador, la coherencia temporal y la calidad de audio. Los evaluadores humanos comparan videos generados en pruebas ciegas, proporcionando calificaciones directas cara a cara que alimentan el sistema Elo.

Esta puntuación multidimensional ayuda a explicar por qué Runway encabeza la tabla de clasificación general a pesar de que los competidores ganen categorías individuales. Google Veo 3 lidera en resolución pura, mientras que Sora 2 a menudo gana en interpretación creativa. Pero la excelencia equilibrada de Gen-4.5 en todas las dimensiones produce la puntuación compuesta más alta.

Qué Significa Esto para los Creadores

Para profesionales de video, las puntuaciones de benchmark importan menos que las capacidades prácticas. Así es como el desempeño de Gen-4.5 se traduce en uso en el mundo real.

Velocidad

Tiempo de Generación

5-7 minutos para un clip de 10 segundos en 1080p, más lento que Sora 2 (2-3 minutos) pero más rápido que alternativas de código abierto locales.

Calidad

Resolución de Salida

Soporte 4K nativo con el pipeline de aumento de escala de Runway, coincidiendo con la salida de calidad profesional de Veo 3.1.

Control

Herramientas Creativas

Imagen a video, pincel de movimiento, controles de cámara y referencias de estilo proporcionan más control directorial que cualquier competidor.

La combinación de control creativo y calidad de salida hace que Gen-4.5 sea particularmente adecuado para flujos de trabajo profesionales. Las agencias de publicidad, los equipos de previsualizaciones de películas y los estudios de contenido la han adoptado para tareas que van desde videos conceptuales hasta contenido de redes sociales.

El Panorama Competitivo en Febrero de 2026

La ventaja de Gen-4.5 en el benchmark no significa que la competencia haya dejado de innovar. El espacio de video IA se mueve rápidamente, y varios desarrollos podrían cambiar las clasificaciones.

🔜

Google Veo 3.2

Previsto para Q2 de 2026, se rumorea que la siguiente iteración de Google se enfoca en la coherencia narrativa de mayor duración y la consistencia mejorada de personajes entre escenas.

💡

OpenAI Sora 3

Aunque OpenAI no ha anunciado Sora 3, la asociación con Disney sugiere capacidades importantes en desarrollo para generación de personajes con licencia.

🚀

Kling 3.0

El calendario de lanzamiento agresivo de Kuaishou podría traer otro contendiente de benchmark de China antes de mediados de año.

Más Allá de los Benchmarks: La Perspectiva Más Amplia

Números como 1 247 Elo cuentan parte de la historia, pero no capturan todo. La generación de video IA ha alcanzado un punto donde todos los modelos de nivel superior producen resultados notables. Las diferencias radican en casos de uso específicos, precios e integración de ecosistema.

La ventaja de Runway no es solo la puntuación de benchmark. Es el refinamiento de flujos de trabajo a lo largo de los años que convierte a Gen-4.5 en una herramienta práctica en lugar de una demostración tecnológica. Características como pincel de movimiento, controles de cámara precisos e integración perfecta con software de edición profesional reflejan un enfoque en la forma en que los creadores realmente trabajan.

💡

Para una guía práctica para obtener los mejores resultados de cualquier herramienta de video IA, consulta nuestra guía completa de ingeniería de indicadores.

Mirando Hacia Adelante

La puntuación Elo de 1 247 marca un hito, pero no un punto final. La generación de video IA continúa avanzando a un ritmo que convierte los benchmarks de hoy en los baselines de mañana. Lo que importa más que cualquier puntuación individual es la trayectoria: modelos que entienden la física, mantienen la coherencia y dan a los creadores control intuitivo.

Runway Gen-4.5 lidera esa trayectoria hoy. Mañana traerá nuevos desafiadores, nuevas capacidades y nuevos benchmarks. Por ahora, los datos están claros: si necesitas la generación de video IA más capaz disponible, Runway se ha ganado el primer puesto.


Datos de benchmark obtenidos de Artificial Analysis AI Video Arena, febrero de 2026. Las puntuaciones Elo reflejan la tabla de clasificación actual y pueden cambiar a medida que se evalúen nuevos modelos.

Alexis
AlexisAI EngineerAI Author

Ingeniero de IA de Lausana que combina profundidad investigadora con innovación práctica. Divide su tiempo entre arquitecturas de modelos y cumbres alpinas.

View profile →

¿Te ha gustado lo que has leído?

Convierte tus ideas en vídeos con IA de duración ilimitada en minutos.

Artículos relacionados

Sigue explorando con estas publicaciones relacionadas

¿Te ha gustado este artículo?

Descubre más ideas y mantente al día con nuestro contenido más reciente.