¿Es Gemini Omni 1.1 Flash realmente el número uno? Lo que dicen las tablas
Cada post de «el nuevo modelo de vídeo de Google es el número uno» que ha leído hoy está citando la clasificación de otro modelo.
Gemini Omni 1.1 Flash pasó ayer a disponibilidad general. Artificial Analysis, la tabla a la que apuntan la mayoría de esos posts, no lo sigue: ni en text-to-video, ni en image-to-video, ni en edición de vídeo. Las posiciones que se citan pertenecen a Gemini Omni Flash, el modelo de preview de junio, y casi todas pertenecen a una vista concreta de una tabla concreta.
Eso no es motivo para descartar el modelo. Es motivo para mirar lo que sí se ha medido, que resulta ser más interesante que el titular.

Dónde se ha clasificado de verdad la 1.1
En un solo sitio: arena.ai, que añadió gemini-omni-1.1-flash a dos de sus tablas el 27 de agosto de 2026, el día en que se lanzó. Consultado el 28 de agosto:
| Tabla | Posición | Elo | Votos |
|---|---|---|---|
| arena.ai Text-to-Video | 1.ª | 1515 ±16 | 1.762 |
| arena.ai Image-to-Video | 2.ª | 1488 ±11 | 3.720 |
Así que sí: hay una tabla en la que Gemini Omni 1.1 Flash está el primero. Ahora la parte que los titulares omiten. El segundo puesto de esa tabla lo ocupa Gemini Omni Flash con 1512 ±10, sobre 19.830 votos. Tres puntos de Elo, con intervalos de confianza que se solapan por completo, y aproximadamente una décima parte de la muestra.
Eso es un empate estadístico, no una victoria. Una diferencia de tres puntos sobre 1.762 votos está de lleno dentro del ruido, y la cifra se moverá a medida que se acumulen votos. Si ve esto citado el mes que viene como «Omni 1.1 es el mejor modelo de text-to-video», compruebe si quien lo cita miró el intervalo.
Y luego está lo que falta. La 1.1 no ha sido añadida a ninguna tabla de edición de vídeo, ni en arena.ai ni en ningún otro sitio, y la edición es la capacidad alrededor de la cual Google construyó el lanzamiento.
La trampa del audio en las cifras de Artificial Analysis
Artificial Analysis publica cada tabla de vídeo dos veces: con audio y sin audio. Casi nadie de quienes citan estas cifras dice a cuál se refiere, y las dos discrepan con fuerza.
Este es Gemini Omni Flash en ambas vistas, consultado el 28 de agosto de 2026:
| Tabla | Sin audio | Con audio |
|---|---|---|
| Text-to-Video | 1.º — 1.322 | 2.º — 1.237, por detrás de Wan 3.0 con 1.240 |
| Image-to-Video | 1.º — 1.365 | 4.º — 1.179 |
La fila de image-to-video es la que hay que asimilar. El primer puesto se convierte en el cuarto según qué vista abra, y un post que dice «número uno en image-to-video» sin nombrar la vista no está informando de un resultado: está eligiendo uno.
Las dos vistas son legítimas. El audio es una parte real de lo que producen ahora estos modelos, y un modelo que genera una imagen fuerte con un sonido flojo debería, genuinamente, quedar más abajo en una tabla que cuenta el sonido. Pero la distancia entre el primero y el cuarto es exactamente el tipo de detalle que desaparece en un titular.
La tabla de edición, con la fecha correcta
Circula una historia según la cual Gemini Omni Flash debutó como número uno en edición de vídeo y después MiniMax H3 lo empujó al segundo puesto. Eso fue cierto. Dejó de serlo hace ya un tiempo.
- Finales de julio de 2026 — ya 2.º, con 1.122 por detrás de MiniMax H3 con 1.130
- 6 de agosto de 2026 — 2.º, 1.123 frente a 1.132
- 28 de agosto de 2026 — 3.º, con 1.124, con Wan 3.0 primero con 1.189 y MiniMax H3 segundo con 1.128
El Wan 3.0 de Alibaba lidera ahora dos de las tres tablas de Artificial Analysis, que es el dato menos reportado de todo este asunto. En la tabla de edición de vídeo de arena.ai, Gemini Omni Flash está el cuarto, por detrás de dos variantes de Seedance y de MiniMax H3, y su puntuación allí de hecho subió durante el periodo, de 1.347 a 1.358. No empeoró. Lo adelantaron.
Esa es la forma honesta de este mercado. Cuatro laboratorios se van intercambiando posiciones, el líder depende de qué tabla y qué vista abra, y nadie lo tiene todo.

Lo que afirmó el propio Google
Nada. Ni un solo Elo, benchmark o puesto de clasificación aparece en el anuncio de Google, en la model card ni en la documentación de la API. El lanzamiento es una lista de funciones y un precio.
Creemos que eso merece leerse como una señal y no como una omisión. Un laboratorio que tuviera un resultado decisivo en benchmarks normalmente abre con él. Google abrió con la extensión de escena, el control de fotogramas y un nivel de borrador más barato: las cosas que uno destacaría si la ventaja de su modelo estuviera en el flujo de trabajo y no en un cara a cara. El único número que Google sí publicó es un precio, y cubrimos qué cambió realmente el lanzamiento en otro artículo.
Tampoco existe, a día de hoy, ninguna comparación independiente cara a cara de la 1.1 frente a su predecesor. Todos los artículos que pueda encontrar son una reescritura del anuncio. Quien le diga cuánto mejor es la 1.1 no lo ha medido, porque todavía no hay nada con lo que medirlo.
Entonces, qué conviene ejecutar hoy
Esta es la parte que las tablas le están diciendo en voz baja: el modelo que las encabeza no es el nuevo. Es el predecesor. Hasta el 28 de agosto de 2026 eso era una limitación real, porque a la 1.1 todavía no se le podía llamar aquí. Ahora sí, lo que cambia la pregunta de qué puede ejecutar a qué debería ejecutar.
Omni Flash, el modelo que hay detrás de todos los primeros puestos sin audio citados arriba, sigue funcionando en nuestra API. Pero a Gemini Omni 1.1 Flash se le puede llamar aquí desde el 28 de agosto de 2026 a $0.09 por segundo a 720p, y el argumento a su favor nunca iba a ser una clasificación. Son las cosas que el modelo antiguo no puede hacer en absoluto: image-to-video y start-end-frame-to-video, ambas nuevas para esta familia en E2X, reference-to-video admitiendo hasta siete imágenes de referencia, un nivel de borrador a 360p por $0.0297 por segundo y clips que llegan a diez segundos. Vea el artículo del lanzamiento para saber qué cambió realmente entre los dos.
Ahora la aritmética incómoda. Veo 3.1 Fast cuesta un céntimo por segundo —una novena parte de lo que cuesta Omni 1.1 Flash— y es a todas luces el modelo más débil, en torno al noveno puesto una vez que se cuenta el audio.
Pero mire la proporción y no la clasificación. Nueve veces el dinero frente a unas pocas decenas de puntos de Elo, en una escala en la que todo el top diez abarca unos 120. Un solo plano de ocho segundos es la diferencia entre ocho céntimos y setenta y dos, y los sesenta y cuatro céntimos de diferencia compran ocho intentos más en el nivel barato. La mayoría de los planos no necesitan el mejor modelo. Necesitan tres intentos más.
La prima deja de ser opcional cuando un trabajo necesita continuidad: un personaje que tiene que sobrevivir de un plano a otro, un fotograma de apertura y otro de cierre especificados, un clip que se extiende después. Ahí un modelo más débil no se degrada con elegancia, sencillamente falla. Veo 3.1 Fast seguirá cubriendo buena parte de eso —image-to-video, reference-to-video, primer y último fotograma—, así que deje que sea un fallo real, y no una tabla de clasificación, lo que le haga subir de nivel.
Los precios y las condiciones de producto pueden cambiar. Compruebe el precio vigente de cada proveedor antes de tomar una decisión de compra. Esta es una comparación acotada, no una afirmación de que E2X sea la opción más barata en todas las configuraciones.
Cómo leer una tabla de clasificación de vídeo sin quemarse
Cuatro hábitos, y le servirán mucho después de que estas cifras concretas hayan caducado:
- Compruebe la cadena del modelo, no el nombre comercial. «Gemini Omni Flash» y «Gemini Omni 1.1 Flash» son productos distintos, y casi todos los artículos publicados esta semana usan el primer nombre para el segundo modelo.
- Pregunte qué vista. Con audio o sin audio convierte el primer puesto en el cuarto en una de las tablas de arriba.
- Lea el recuento de votos y el intervalo. Una ventaja de tres puntos sobre 1.762 votos es un cara o cruz disfrazado de resultado.
- Mire la fecha de la clasificación, no la fecha del artículo. Una pieza publicada ayer puede estar citando una instantánea de julio, y dos de las afirmaciones más compartidas sobre este tema son exactamente eso.
Elija por tipo de trabajo desde text-to-video o reference-to-video, o lea la especificación legible por máquina: Omni 1.1 Flash publica una con todos los parámetros y el precio actual. La gama completa está en nuestro catálogo.
Preguntas frecuentes
¿Es Gemini Omni 1.1 Flash el número uno en las tablas de vídeo?
En una tabla, por poco y de forma provisional. Está el primero en la Text-to-Video Arena de arena.ai con 1515 ±16, pero solo tres puntos de Elo por delante de su propio predecesor, sobre 1.762 votos frente a 19.830 y con intervalos de confianza solapados: un empate estadístico. Está el segundo en Image-to-Video de arena.ai y no aparece en absoluto en las tablas de Artificial Analysis.
¿Clasifica Artificial Analysis a Gemini Omni 1.1 Flash?
No. A fecha de 28 de agosto de 2026, Gemini Omni 1.1 Flash no aparece en ninguna de las tres tablas de vídeo de Artificial Analysis. Todas las cifras de Artificial Analysis que circulan sobre «Omni Flash» se refieren al modelo de preview anterior, Gemini Omni Flash, lanzado en junio de 2026.
¿Por qué distintos sitios dan clasificaciones distintas del mismo modelo?
Sobre todo porque Artificial Analysis publica cada tabla dos veces, con audio y sin audio, y la mayoría de los artículos no dice cuál usó. Gemini Omni Flash es el primero en image-to-video sin audio y el cuarto con audio. La elección de tabla, la fecha y la cuestión del audio explican casi todas las contradicciones que va a encontrar.
¿Sigue siendo Gemini Omni Flash el número uno en edición de vídeo?
No. Debutó en lo más alto, fue segundo por detrás de MiniMax H3 durante finales de julio y principios de agosto, y está tercero a fecha de 28 de agosto de 2026, con Wan 3.0 primero. Su puntuación no bajó: subió ligeramente, de 1.347 a 1.358 en arena.ai, pero otros modelos mejoraron más rápido.
¿Publicó Google algún resultado de benchmark de Gemini Omni 1.1 Flash?
No. El blog del anuncio de Google, la documentación de la API y la model card de DeepMind no contienen ningún Elo, benchmark ni afirmación de puesto de clasificación para el modelo. El material de lanzamiento cubre solo funciones, disponibilidad y precios.
¿Qué modelo de vídeo es el mejor ahora mismo?
No hay una única respuesta, que es la lectura honesta de las tablas. El Wan 3.0 de Alibaba lidera dos de las tres tablas de Artificial Analysis, MiniMax H3 lidera la de image-to-video de arena.ai, el Seedance 2.5 de ByteDance lidera su tabla de edición de vídeo, y Gemini Omni Flash lidera las dos tablas de Artificial Analysis en su vista sin audio. Elija por el trabajo que tenga, no por un titular.
¿Merece la pena Gemini Omni 1.1 Flash frente a un modelo más barato?
Para clips sueltos sin requisitos de edición ni de continuidad, normalmente no. Veo 3.1 Fast va a $0.01 por segundo frente a los $0.09 de Gemini Omni 1.1 Flash en nuestra API a fecha de 28 de agosto de 2026: una diferencia de nueve veces por unas pocas decenas de puntos de Elo. La prima se justifica en la consistencia por referencias, el control de primer y último fotograma y la extensión de escena, donde un modelo más débil no solo se ve peor, sino que falla en la tarea.