Guía práctica
Guía de prompts para Gemini Omni
Una guía práctica y sin rodeos: qué funciona, qué falla y qué conviene evitar. Se basa en la guía oficial de prompts de DeepMind y en las pruebas de la comunidad publicadas por PixVerse, Atlas Cloud, Chrome Unboxed y el Gemini Omni Prompt Playbook de Medium.
Qué ha cambiado en los últimos 30 días
Cronología, con fechas, de todos los cambios relevantes desde el lanzamiento. La actualizamos cada vez que algo se mueve.
- 19 de mayo de 2026 — Gemini Omni Flash se presenta en Google I/O 2026. DeepMind publica la tarjeta del modelo (model card) 🟢. Ese mismo día llega a los suscriptores de AI Plus, Pro y Ultra de todo el mundo a través de la aplicación Gemini y Google Flow, y gratis a YouTube Shorts y la aplicación YouTube Create (mayores de 18 años). La API para desarrolladores y empresas quedó prometida «en las próximas semanas». (Fuente: blog.google 🟢.)
- 19 de mayo de 2026 — Google reorganiza los precios de sus suscripciones de IA: Plus a $7.99, Pro a $19.99, un nuevo nivel Ultra a $99.99 (pensado para creadores) y el Ultra que ya existía baja de $250 a $200. (Fuente: blog de Google One sobre las suscripciones 🟢.)
- 19-20 de mayo de 2026 — La función Avatars empieza a llegar a los suscriptores de pago. Solo para mayores de 18 años y sin acceso desde el EEE, Suiza ni el Reino Unido. (Fuente: Ayuda de Google Gemini sobre Avatar 🟢.)
- 20 de mayo de 2026 — La comunidad denuncia en masa falsos positivos: rechazos por «infracción de políticas» con prompts inofensivos. Josh Woodward, vicepresidente de Google, lo reconoce públicamente y dice que la empresa lo está investigando. Situación a 29 de mayo de 2026: no se ha anunciado ninguna solución. Más abajo lo explicamos en la sección sobre «los dos errores».
- 28 de mayo de 2026 — Woodward anuncia la corrección de un error distinto: el del cómputo de cuota. Las solicitudes fallidas dejan de descontar cuota, se duplica la asignación de Omni en AI Ultra, los prompts de Gemini 3.1 Flash-Lite pasan a ser gratuitos y la cuota por prompt en Pro queda limitada. (Fuentes: 9to5Google 🟡, The Hans India 🟡.)
Nivel de la fuente: 🟢 oficial de Google/DeepMind · 🟡 prueba directa o medio de noticias fiable · 🔴 sin verificar.
Quién puede usar Gemini Omni Flash (y cuánto cuesta)
Planes de acceso (tras la reorganización de I/O 2026)
| Plan | Precio al mes | Qué incluye para Omni |
|---|---|---|
| Google AI Plus | $7.99 | Acceso a Omni Flash en la aplicación Gemini y en Google Flow |
| Google AI Pro | $19.99 | Más cuota, con límite por prompt (desde la actualización del 28 de mayo) |
| Nuevo Ultra (creadores) | $99.99 | 5 veces el uso de Pro, 20 TB de almacenamiento y YouTube Premium incluido |
| Ultra anterior | $200 (antes $250) | 20 veces el uso de Pro, 12 500 créditos de IA, Project Genie / Mariner |
| Opción gratuita | $0 | YouTube Shorts y la aplicación YouTube Create (mayores de 18 años, con algunos límites) |
Fuente: blog de Google One sobre las suscripciones de IA 🟢.
Créditos por generación (pregunta abierta)
Google no ha publicado cuántos créditos gasta cada generación de Omni Flash en Google Flow. Estas son las mejores pistas disponibles a 29 de mayo de 2026:
- Nuestras propias pruebas (Cited, 28 de mayo de 2026): una generación nueva de 10 segundos en 16:9 costó 30 créditos. Una sola edición conversacional del mismo clip costó 40 créditos; es decir, editar sale un 33 % más caro que volver a generar desde cero. 🟡
- La cobertura del lanzamiento de WaveSpeed habla de 15 créditos por un clip nuevo de 4 segundos y 40 por una edición: la generación cuesta distinto, la edición cuesta lo mismo. Puede tratarse de un descuento para clips más cortos o de que los precios hayan cambiado desde entonces. 🟡
- La única señal de precios verificada de Google es que el plan Ultra anterior incluye 12 500 créditos de IA al mes. Eso confirma que los créditos son la moneda común, pero la tarifa de Omni por generación no aparece en ninguna fuente oficial.
En la práctica: si la generación no te dio lo que buscabas, vuelve a generar en vez de editar. Editar gasta más créditos y a menudo produce un resultado que, a simple vista, no se distingue del original.
Dónde usarlo
- Aplicación Gemini: la interfaz principal; requiere un plan de IA de pago.
- Google Flow, en labs.google/flow: el espacio de trabajo completo, con línea de tiempo y edición conversacional.
- YouTube Shorts y la aplicación YouTube Create: acceso gratuito a Omni Flash para mayores de 18 años.
- API para desarrolladores y empresas: prometida «en las próximas semanas» en el lanzamiento (19 de mayo de 2026); a 29 de mayo de 2026 aún no está abierta a todo el mundo.
La fórmula base
La mayoría de los prompts para Gemini Omni que funcionan siguen esta estructura (sujeto, acción, escenario, cámara, iluminación y estilo):
[Subject] + [Action] + [Setting] + [Camera] + [Lighting] + [Style] Ejemplo: "A red panda chef tossing pizza dough, in a cozy mountain kitchen, low-angle close-up, warm tungsten light, Pixar-style 3D animation".
La base es la misma que en los prompts de Sora o Veo, pero Omni añade dos elementos propios que la mayoría de los modelos no tienen:
- La sintaxis «
@username» para hacer aparecer a un personaje (función Avatar) - La edición conversacional encadenada ("now change X, keep Y identical")
El truco de la primera frase
Deja fijadas estas tres cosas en la primera frase del prompt:
Create a [duration]-second [aspect-ratio] [genre] video in one continuous shot. Por qué: Omni interpreta "one continuous shot" (plano secuencia) como «sin cortes» y respeta la duración y la relación de aspecto que indiques desde el principio. Escribirlas en el propio prompt funciona mejor que ponerlas en los metadatos.
Vocabulario de cámara que Omni entiende
Según la guía de prompts de DeepMind, Omni reconoce expresamente estos términos:
Verbos de movimiento de cámara
- Acercamiento (push): push in / punch in / dolly zoom
- Alejamiento (pull): pull-back / pull-up / pull-down
- Revelación (reveal): ascend revealing / pull-back and rotate
- Órbita (orbit): orbit around / sweep around / circle
- Paneo (pan): pan left / pan right / vertical pan
- Cámara fija (static): locked off / fixed / oner / continuous shot
Referencias de estilo
- natural smartphone zoom: zoom natural de teléfono
- film camera: cámara de cine analógica (tono cálido, algo de grano)
- webcam style: estilo webcam (imagen comprimida y algo blanda)
- handheld: cámara en mano (microtemblor, sensación orgánica)
Duraciones recomendadas
| Objetivo | Duración ideal | Relación de aspecto |
|---|---|---|
| Ambiente / cinematográfico | 8-10 s | 16:9 o 2.39:1 |
| Producto en plano de presentación | 6-8 s | 1:1 o 16:9 |
| Reels / TikTok / Shorts | 5-7 s | 9:16 |
| Impacto en cámara lenta | 5-6 s | 1:1 o 16:9 |
| Timelapse | 10 s (máx.) | 16:9 |
| Avatar hablando a cámara | 10 s (máx.) | 16:9 o 9:16 |
Límite de Gemini Omni Flash: 10 segundos por clip. Fuente: cobertura del lanzamiento en TechCrunch.
La cláusula «Keep X identical»
Cuando uses la edición conversacional (la función estrella de Omni), cada turno de seguimiento debe decir de forma explícita qué hay que conservar. El patrón:
[Change instruction]. Keep [X, Y, Z] exactly the same. Sin esta cláusula, Omni puede cambiar el estilo de toda la escena cuando solo le pides modificar un elemento, y se pierde la coherencia, que es precisamente lo que da sentido a la edición conversacional. (Lo documentan las pruebas de Atlas Cloud.)
El patrón de activación (para VFX)
Uno de los patrones que mejor funcionan en Omni. Google lo usó en sus propias demos virales (el brazo que se convierte en espejo, la escultura de burbujas, los barcos de origami):
[Base scene]. When [specific trigger action], [specific transformation]. Keep [list] identical. Ejemplo: "A woman reaches toward a mirror. When her fingertips touch the glass, make the mirror ripple like liquid and her arm turn to reflective mirror material. Keep the parlor and lighting identical."
«Me está bloqueando el prompt»: los dos errores que no debes confundir
Desde el lanzamiento, la queja «Gemini Omni me bloquea los prompts» se ha usado para describir dos errores completamente distintos. Mezclarlos es, ahora mismo, lo que más confusión genera en la comunidad.
Error A: el falso bloqueo por políticas (sin resolver a 29 de mayo de 2026)
Omni rechaza prompts claramente inofensivos (Cat walks between rabbits,
Change the background to night) con un mensaje genérico como "I can't generate that video" o "policy violation" (o su equivalente en tu idioma),
alegando una infracción que no existe. Las quejas se repiten desde el 19 de mayo de 2026. El vicepresidente de Google Josh Woodward
reconoció el problema públicamente y dijo que Google lo estaba investigando y recopilando ejemplos.
A día de hoy no se ha anunciado ninguna solución, y los usuarios siguen publicando casos nuevos en el
foro de Google AI Developers 🟡.
Para distinguir bien qué es una política real y qué es este error, lee nuestro
análisis a fondo del error A.
Error B: el fallo en el cómputo de cuota (corregido el 28 de mayo de 2026)
No tiene nada que ver con el bloqueo por políticas: era un error de facturación por el que las generaciones fallidas (incluidas las que cortaba el error A) se seguían descontando de tu cuota. El 28 de mayo de 2026, Woodward anunció:
- Las solicitudes fallidas ya no descuentan cuota.
- La asignación de Omni en AI Ultra se duplica.
- Los prompts de Gemini 3.1 Flash-Lite pasan a ser totalmente gratuitos.
- La cuota por prompt de Pro queda limitada para evitar consumos desbocados.
Fuente: 9to5Google 🟡.
Cómo saber cuál te ha tocado
- Te aparece un mensaje de «policy violation» o «I can't generate that video» con un prompt a todas luces inocente → error A. No reescribas el prompt diez veces: es el fallo. Vuelve a intentarlo más tarde o cambia un poco la redacción.
- Tu cuota bajó aunque la generación falló o fue rechazada → error B. Ya debería estar resuelto; si todavía te pasa, contacta con el soporte de Google e indica el ID de la solicitud.
Fallos conocidos (conviene asumirlos)
La propia ficha del modelo de DeepMind los recoge expresamente como «Known Limitations» (limitaciones conocidas) 🟢. Así que, cuando te topes con ellos, no es un problema de cómo escribes el prompt: es un límite del modelo.
Texto en pantalla
Cualquier texto en pantalla (etiquetas, carteles, subtítulos, logotipos de marcas) sale deformado. No pidas textos superpuestos en el prompt. Lo confirma la prueba de PixVerse.
Movimiento de las manos
Manos que sujetan objetos, lengua de signos, escribir en un teclado: los movimientos finos pierden precisión. Si puedes, encuadra de modo que las manos no se vean, o acepta cierta imperfección.
Coherencia del personaje entre planos
Según el análisis multiturno de Atlas Cloud,
Omni saca un 3/5 en coherencia del personaje a partir de 4 planos. Usa @character_name
con una imagen de referencia para obtener los mejores resultados y cuenta con que, pasado el cuarto plano, el personaje empiece a cambiar.
Movimientos complejos
Según la prueba de digit.in, las acciones complejas (bailar, hacer gimnasia, tocar un instrumento) muestran más defectos visuales propios de la IA que los planos estáticos. Las acciones sencillas (caminar, estar de pie, hablar) son las que mejor salen.
Más de 50 palabras
Según el análisis de Seaart, los prompts de más de unas 50 palabras dispersan la atención del modelo y empeoran el resultado. Sé concreto, pero breve.
Qué NO hacer
- No amontones adjetivos al estilo de Veo: DeepMind dice expresamente que con Omni «no hace falta ser tan prescriptivo como con Veo». El lenguaje natural funciona mejor que las plantillas.
- No cambies varias variables en un mismo turno: repártelas en turnos de conversación distintos.
- No cites por su nombre obras o personajes protegidos: "Studio Ghibli style" es arriesgado; "hand-painted watercolor animation" es más seguro.
- No uses la sintaxis propia de Veo o Sora: Omni entiende una parte, pero está optimizado para su propio estilo conversacional.
- No pidas marcas de equipos ("shot on DJI Mavic Pro"): Omni no interpreta marcas de cámara; usa verbos de movimiento.
Reglas estrictas de la función Avatar
- Edad mínima: 18 años
- Zonas: NO disponible en el EEE, Suiza ni el Reino Unido en el lanzamiento
- Idioma: solo inglés en el lanzamiento (mayo de 2026)
- Marca de agua: todos los videos llevan SynthID de Google, que no se puede desactivar y va incrustada en los píxeles
- Grabación de referencia: ojos, nariz y boca bien visibles; sin gafas de sol, mascarillas ni gorros que tapen la cara; ninguna otra cara en el fondo
Fuente: página de ayuda de Google Gemini sobre Avatar.
Fuentes
- Oficial: guía de prompts de Gemini Omni (DeepMind)
- Lanzamiento oficial: anuncio en blog.google
- Detalles de Avatar: Ayuda de Google Gemini sobre Avatar
- Prueba directa: Atlas Cloud, resumen de funciones
- Prueba directa: PixVerse, análisis del modelo
- Prueba de Avatar: Chrome Unboxed, prueba de Avatar
- Recopilación: Medium — Gemini Omni Prompt Playbook
- Análisis de limitaciones: prueba de digit.in
- Ficha del modelo (oficial): DeepMind — Gemini Omni Flash
- Cambio de precios: blog de Google One sobre las suscripciones de IA
- Anuncio de la corrección de cuota: 9to5Google, nuevos límites de uso
- Hilo activo sobre el error: foro de Google AI Developers, n.º 147152
Última actualización: 29 de mayo de 2026. Volvemos a verificar cada dato y actualizamos esta página cada vez que Google introduce un cambio. ¿Has visto algo incorrecto o desactualizado? Avísanos: leemos todos los correos.