O Gemini Omni 1.1 Flash é mesmo o número um? O que os rankings dizem
Todo post do tipo "o novo modelo de vídeo do Google é o número um" que você leu hoje está citando um ranking de outro modelo.
O Gemini Omni 1.1 Flash ficou geralmente disponível ontem. A Artificial Analysis, o ranking para o qual a maioria desses posts aponta, não acompanha ele — nem em text-to-video, nem em image-to-video, nem em edição de vídeo. As colocações que estão sendo citadas pertencem ao Gemini Omni Flash, o modelo de preview de junho, e a maioria delas pertence a uma visão específica de um ranking específico.
Isso não é motivo para descartar o modelo. É motivo para olhar o que foi de fato medido, o que acaba sendo mais interessante que a manchete.

Onde o 1.1 foi genuinamente ranqueado
Num lugar só: a arena.ai, que adicionou o gemini-omni-1.1-flash a dois dos seus rankings em 27 de agosto de 2026, o dia em que ele saiu. Lido em 28 de agosto:
| Ranking | Posição | Elo | Votos |
|---|---|---|---|
| arena.ai Text-to-Video | 1º | 1515 ±16 | 1.762 |
| arena.ai Image-to-Video | 2º | 1488 ±11 | 3.720 |
Então sim — existe um ranking em que o Gemini Omni 1.1 Flash está em primeiro. Agora a parte que as manchetes deixam de fora. O segundo lugar nesse ranking é o Gemini Omni Flash com 1512 ±10, sobre 19.830 votos. Três pontos de Elo, com intervalos de confiança que se sobrepõem completamente, e mais ou menos um décimo da amostra.
Isso é um empate estatístico, não uma vitória. Uma diferença de três pontos sobre 1.762 votos está bem dentro do ruído, e o número vai se mexer conforme os votos se acumulam. Se você vir isso citado mês que vem como "o Omni 1.1 é o melhor modelo de text-to-video", verifique se quem cita olhou o intervalo.
Depois tem o que está ausente. O 1.1 não foi adicionado a nenhum ranking de edição de vídeo, nem na arena.ai nem em lugar nenhum — e edição é a capacidade em torno da qual o Google montou o lançamento.
A armadilha do áudio nos números da Artificial Analysis
A Artificial Analysis publica cada ranking de vídeo duas vezes — com áudio e sem. Quase ninguém que cita esses números diz a qual dos dois se refere, e os dois discordam com força.
Aqui está o Gemini Omni Flash nas duas visões, lidas em 28 de agosto de 2026:
| Ranking | Sem áudio | Com áudio |
|---|---|---|
| Text-to-Video | 1º — 1.322 | 2º — 1.237, atrás do Wan 3.0 com 1.240 |
| Image-to-Video | 1º — 1.365 | 4º — 1.179 |
A linha de image-to-video é a que merece atenção. O primeiro lugar vira quarto dependendo de qual visão você abre, e um post que diz "número um em image-to-video" sem nomear a visão não está reportando um resultado, está escolhendo um.
As duas visões são legítimas. Áudio é parte real do que esses modelos produzem hoje, e um modelo que gera imagem forte com som fraco genuinamente deveria ficar mais abaixo num ranking que conta som. Mas a distância entre primeiro e quarto é exatamente o tipo de detalhe que some numa manchete.
O ranking de edição, com a data correta
Circula uma história de que o Gemini Omni Flash estreou em primeiro em edição de vídeo e depois foi empurrado para segundo pelo MiniMax H3. Isso foi verdade. Deixou de ser verdade faz um tempo.
- Fim de julho de 2026 — já em 2º, com 1.122 atrás do MiniMax H3 com 1.130
- 6 de agosto de 2026 — 2º, 1.123 contra 1.132
- 28 de agosto de 2026 — 3º, com 1.124, tendo o Wan 3.0 em primeiro com 1.189 e o MiniMax H3 em segundo com 1.128
O Wan 3.0, da Alibaba, agora lidera dois dos três rankings da Artificial Analysis, o que é o fato menos reportado deste assunto inteiro. No ranking de edição de vídeo da arena.ai o Gemini Omni Flash está em quarto, atrás de duas variantes do Seedance e do MiniMax H3 — e a pontuação dele ali na verdade subiu ao longo do período, de 1.347 para 1.358. Ele não piorou. Ele foi ultrapassado.
Esse é o formato honesto deste mercado. Quatro laboratórios estão trocando de posição, o líder depende de qual ranking e qual visão você abre, e ninguém detém tudo.

O que o próprio Google alegou
Nada. Nenhum Elo, benchmark ou colocação de ranking aparece no anúncio do Google, no model card ou na documentação da API. O lançamento é uma lista de recursos e um preço.
Achamos que isso vale ser lido como sinal, e não como omissão. Um laboratório que tivesse um resultado de benchmark decisivo normalmente abriria com ele. O Google abriu com extensão de cena, controle de frames e um tier de rascunho mais barato — as coisas que você enfatizaria se a vantagem do seu modelo estivesse no fluxo de trabalho e não numa vitória direta. O único número que o Google publicou foi um preço, e cobrimos o que o lançamento de fato mudou em separado.
Também não existe, até hoje, nenhuma comparação direta e independente do 1.1 contra o antecessor. Todo artigo que você encontra é uma reescrita do anúncio. Quem estiver te dizendo o quanto o 1.1 é melhor não mediu, porque ainda não há nada com que medir.
Então o que você deveria rodar hoje
Aqui está a parte que os rankings estão discretamente te dizendo: o modelo que lidera eles não é o novo. É o antecessor. Até 28 de agosto de 2026 isso era uma restrição real, porque o 1.1 ainda não era chamável aqui. Agora é, o que muda a pergunta de o que você consegue rodar para o que você deveria rodar.
O Omni Flash, o modelo por trás de todo primeiro lugar sem áudio citado acima, continua rodando na nossa API. Mas o Gemini Omni 1.1 Flash está chamável aqui desde 28 de agosto de 2026 a $0.09 por segundo em 720p, e o argumento a favor dele nunca ia ser um ranking. São as coisas que o modelo mais velho simplesmente não faz: image-to-video e start-end-frame-to-video, ambos inéditos nesta família na E2X, reference-to-video aceitando até sete imagens de referência, um tier de rascunho em 360p a $0.0297 por segundo, e clipes que chegam a dez segundos. Veja o texto sobre o lançamento para o que de fato mudou entre eles.
Agora a aritmética incômoda. O Veo 3.1 Fast custa um centavo por segundo, um nono do que o Omni 1.1 Flash custa, e ele é claramente o modelo mais fraco, ficando lá pela nona posição quando o áudio entra na conta.
Mas olhe a razão em vez do ranking. Nove vezes o dinheiro contra algumas dezenas de pontos de Elo, numa escala em que o top dez inteiro cobre cerca de 120. Uma única tomada de oito segundos é a diferença entre oito centavos e setenta e dois, e os sessenta e quatro centavos no meio compram oito tentativas a mais no tier barato. A maioria das tomadas não precisa do melhor modelo. Precisa de mais três tentativas.
O prêmio deixa de ser opcional quando um trabalho precisa de continuidade: um personagem que tem que sobreviver de um plano para outro, um frame de abertura e de fechamento especificados, um clipe que vai ser estendido depois. Aí um modelo mais fraco não degrada com elegância, ele simplesmente falha. O Veo 3.1 Fast ainda dá conta de boa parte disso — image-to-video, reference-to-video, primeiro e último frame — então deixe que uma falha real, e não um ranking, seja o que te faz subir.
Preços e termos de produto podem mudar. Verifique o preço atual de cada provedor antes de tomar uma decisão de compra. Esta é uma comparação com escopo definido, não uma afirmação de que a E2X é a opção mais barata em toda configuração.
Como ler um ranking de vídeo sem se queimar
Quatro hábitos, e eles vão te servir muito depois que esses números específicos estiverem velhos:
- Verifique a string do modelo, não o nome de marketing. "Gemini Omni Flash" e "Gemini Omni 1.1 Flash" são produtos diferentes, e quase todo artigo publicado esta semana usa o primeiro nome para o segundo modelo.
- Pergunte qual visão. Com áudio ou sem transforma primeiro lugar em quarto em um dos rankings acima.
- Leia a contagem de votos e o intervalo. Uma vantagem de três pontos sobre 1.762 votos é cara ou coroa vestida de resultado.
- Verifique a data da colocação, não a data do artigo. Um texto publicado ontem pode estar citando um retrato de julho, e duas das afirmações mais compartilhadas neste assunto são exatamente isso.
Escolha por tipo de trabalho a partir de text-to-video ou reference-to-video, ou leia a especificação legível por máquina — o Omni 1.1 Flash publica uma com cada parâmetro e o preço atual. A linha completa está no nosso catálogo.
Perguntas frequentes
O Gemini Omni 1.1 Flash é o número um nos rankings de vídeo?
Em um ranking, por pouco e provisoriamente. Ele está em primeiro na Text-to-Video Arena da arena.ai com 1515 ±16, mas apenas três pontos de Elo à frente do próprio antecessor, sobre 1.762 votos contra 19.830, com intervalos de confiança sobrepostos — um empate estatístico. Ele é segundo no Image-to-Video da arena.ai e não aparece nos rankings da Artificial Analysis.
A Artificial Analysis ranqueia o Gemini Omni 1.1 Flash?
Não. Até 28 de agosto de 2026 o Gemini Omni 1.1 Flash não aparece em nenhum dos três rankings de vídeo da Artificial Analysis. Todo número da Artificial Analysis que circula para "Omni Flash" se refere ao modelo de preview anterior, o Gemini Omni Flash, que saiu em junho de 2026.
Por que sites diferentes dão rankings diferentes para o mesmo modelo?
Principalmente porque a Artificial Analysis publica cada ranking duas vezes, com áudio e sem, e a maioria dos artigos não diz qual usou. O Gemini Omni Flash é primeiro em image-to-video sem áudio e quarto com áudio. Escolha de ranking, data e a questão do áudio explicam quase toda contradição que você vai encontrar.
O Gemini Omni Flash ainda é o número um em edição de vídeo?
Não. Ele estreou no topo, ficou em segundo atrás do MiniMax H3 no fim de julho e começo de agosto, e está em terceiro em 28 de agosto de 2026, com o Wan 3.0 em primeiro. A pontuação dele não caiu — subiu um pouco, de 1.347 para 1.358 na arena.ai — mas outros modelos melhoraram mais rápido.
O Google publicou algum resultado de benchmark para o Gemini Omni 1.1 Flash?
Não. O blog de anúncio do Google, a documentação da API e o model card da DeepMind não contêm nenhuma alegação de Elo, benchmark ou ranking para o modelo. O material de lançamento cobre apenas recursos, disponibilidade e preço.
Qual é o melhor modelo de vídeo hoje?
Não há uma resposta única, e essa é a leitura honesta dos rankings. O Wan 3.0, da Alibaba, lidera dois dos três rankings da Artificial Analysis, o MiniMax H3 lidera o image-to-video da arena.ai, o Seedance 2.5, da ByteDance, lidera o ranking de edição de vídeo dela, e o Gemini Omni Flash lidera os dois rankings da Artificial Analysis na visão sem áudio. Escolha pelo trabalho que você tem, não por uma manchete.
O Gemini Omni 1.1 Flash vale o preço frente a um modelo mais barato?
Para clipes únicos sem exigência de edição ou continuidade, normalmente não. O Veo 3.1 Fast roda a $0.01 por segundo contra $0.09 do Gemini Omni 1.1 Flash na nossa API em 28 de agosto de 2026 — uma diferença de nove vezes para algumas dezenas de pontos de Elo. O prêmio se justifica em consistência por referência, controle de primeiro e último frame e extensão de cena, onde um modelo mais fraco não fica só pior, ele falha na tarefa.