GEMINI OMNI PROMPTS

Guía práctica

Guía de prompts para Gemini Omni

Una guía práctica y sin rodeos: qué funciona, qué falla y qué conviene evitar. Se basa en la guía oficial de prompts de DeepMind y en las pruebas de la comunidad publicadas por PixVerse, Atlas Cloud, Chrome Unboxed y el Gemini Omni Prompt Playbook de Medium.

Qué ha cambiado en los últimos 30 días

Cronología, con fechas, de todos los cambios relevantes desde el lanzamiento. La actualizamos cada vez que algo se mueve.

Nivel de la fuente: 🟢 oficial de Google/DeepMind · 🟡 prueba directa o medio de noticias fiable · 🔴 sin verificar.

Quién puede usar Gemini Omni Flash (y cuánto cuesta)

Planes de acceso (tras la reorganización de I/O 2026)

PlanPrecio al mesQué incluye para Omni
Google AI Plus$7.99Acceso a Omni Flash en la aplicación Gemini y en Google Flow
Google AI Pro$19.99Más cuota, con límite por prompt (desde la actualización del 28 de mayo)
Nuevo Ultra (creadores)$99.995 veces el uso de Pro, 20 TB de almacenamiento y YouTube Premium incluido
Ultra anterior$200 (antes $250)20 veces el uso de Pro, 12 500 créditos de IA, Project Genie / Mariner
Opción gratuita$0YouTube Shorts y la aplicación YouTube Create (mayores de 18 años, con algunos límites)

Fuente: blog de Google One sobre las suscripciones de IA 🟢.

Créditos por generación (pregunta abierta)

Google no ha publicado cuántos créditos gasta cada generación de Omni Flash en Google Flow. Estas son las mejores pistas disponibles a 29 de mayo de 2026:

En la práctica: si la generación no te dio lo que buscabas, vuelve a generar en vez de editar. Editar gasta más créditos y a menudo produce un resultado que, a simple vista, no se distingue del original.

Dónde usarlo

La fórmula base

La mayoría de los prompts para Gemini Omni que funcionan siguen esta estructura (sujeto, acción, escenario, cámara, iluminación y estilo):

[Subject] + [Action] + [Setting] + [Camera] + [Lighting] + [Style]

Ejemplo: "A red panda chef tossing pizza dough, in a cozy mountain kitchen, low-angle close-up, warm tungsten light, Pixar-style 3D animation".

La base es la misma que en los prompts de Sora o Veo, pero Omni añade dos elementos propios que la mayoría de los modelos no tienen:

El truco de la primera frase

Deja fijadas estas tres cosas en la primera frase del prompt:

Create a [duration]-second [aspect-ratio] [genre] video in one continuous shot.

Por qué: Omni interpreta "one continuous shot" (plano secuencia) como «sin cortes» y respeta la duración y la relación de aspecto que indiques desde el principio. Escribirlas en el propio prompt funciona mejor que ponerlas en los metadatos.

Vocabulario de cámara que Omni entiende

Según la guía de prompts de DeepMind, Omni reconoce expresamente estos términos:

Verbos de movimiento de cámara

Referencias de estilo

Duraciones recomendadas

ObjetivoDuración idealRelación de aspecto
Ambiente / cinematográfico8-10 s16:9 o 2.39:1
Producto en plano de presentación6-8 s1:1 o 16:9
Reels / TikTok / Shorts5-7 s9:16
Impacto en cámara lenta5-6 s1:1 o 16:9
Timelapse10 s (máx.)16:9
Avatar hablando a cámara10 s (máx.)16:9 o 9:16

Límite de Gemini Omni Flash: 10 segundos por clip. Fuente: cobertura del lanzamiento en TechCrunch.

La cláusula «Keep X identical»

Cuando uses la edición conversacional (la función estrella de Omni), cada turno de seguimiento debe decir de forma explícita qué hay que conservar. El patrón:

[Change instruction]. Keep [X, Y, Z] exactly the same.

Sin esta cláusula, Omni puede cambiar el estilo de toda la escena cuando solo le pides modificar un elemento, y se pierde la coherencia, que es precisamente lo que da sentido a la edición conversacional. (Lo documentan las pruebas de Atlas Cloud.)

El patrón de activación (para VFX)

Uno de los patrones que mejor funcionan en Omni. Google lo usó en sus propias demos virales (el brazo que se convierte en espejo, la escultura de burbujas, los barcos de origami):

[Base scene]. When [specific trigger action], [specific transformation]. Keep [list] identical.

Ejemplo: "A woman reaches toward a mirror. When her fingertips touch the glass, make the mirror ripple like liquid and her arm turn to reflective mirror material. Keep the parlor and lighting identical."

«Me está bloqueando el prompt»: los dos errores que no debes confundir

Desde el lanzamiento, la queja «Gemini Omni me bloquea los prompts» se ha usado para describir dos errores completamente distintos. Mezclarlos es, ahora mismo, lo que más confusión genera en la comunidad.

Error A: el falso bloqueo por políticas (sin resolver a 29 de mayo de 2026)

Omni rechaza prompts claramente inofensivos (Cat walks between rabbits, Change the background to night) con un mensaje genérico como "I can't generate that video" o "policy violation" (o su equivalente en tu idioma), alegando una infracción que no existe. Las quejas se repiten desde el 19 de mayo de 2026. El vicepresidente de Google Josh Woodward reconoció el problema públicamente y dijo que Google lo estaba investigando y recopilando ejemplos. A día de hoy no se ha anunciado ninguna solución, y los usuarios siguen publicando casos nuevos en el foro de Google AI Developers 🟡. Para distinguir bien qué es una política real y qué es este error, lee nuestro análisis a fondo del error A.

Error B: el fallo en el cómputo de cuota (corregido el 28 de mayo de 2026)

No tiene nada que ver con el bloqueo por políticas: era un error de facturación por el que las generaciones fallidas (incluidas las que cortaba el error A) se seguían descontando de tu cuota. El 28 de mayo de 2026, Woodward anunció:

Fuente: 9to5Google 🟡.

Cómo saber cuál te ha tocado

Fallos conocidos (conviene asumirlos)

La propia ficha del modelo de DeepMind los recoge expresamente como «Known Limitations» (limitaciones conocidas) 🟢. Así que, cuando te topes con ellos, no es un problema de cómo escribes el prompt: es un límite del modelo.

Texto en pantalla

Cualquier texto en pantalla (etiquetas, carteles, subtítulos, logotipos de marcas) sale deformado. No pidas textos superpuestos en el prompt. Lo confirma la prueba de PixVerse.

Movimiento de las manos

Manos que sujetan objetos, lengua de signos, escribir en un teclado: los movimientos finos pierden precisión. Si puedes, encuadra de modo que las manos no se vean, o acepta cierta imperfección.

Coherencia del personaje entre planos

Según el análisis multiturno de Atlas Cloud, Omni saca un 3/5 en coherencia del personaje a partir de 4 planos. Usa @character_name con una imagen de referencia para obtener los mejores resultados y cuenta con que, pasado el cuarto plano, el personaje empiece a cambiar.

Movimientos complejos

Según la prueba de digit.in, las acciones complejas (bailar, hacer gimnasia, tocar un instrumento) muestran más defectos visuales propios de la IA que los planos estáticos. Las acciones sencillas (caminar, estar de pie, hablar) son las que mejor salen.

Más de 50 palabras

Según el análisis de Seaart, los prompts de más de unas 50 palabras dispersan la atención del modelo y empeoran el resultado. Sé concreto, pero breve.

Qué NO hacer

Reglas estrictas de la función Avatar

Fuente: página de ayuda de Google Gemini sobre Avatar.

Fuentes


Última actualización: 29 de mayo de 2026. Volvemos a verificar cada dato y actualizamos esta página cada vez que Google introduce un cambio. ¿Has visto algo incorrecto o desactualizado? Avísanos: leemos todos los correos.