Google Gemini Omni revoluciona la creación de vídeo con IA
La nueva herramienta de Google DeepMind promete transformar la edición de vídeo, permitiendo modificaciones complejas y coherentes a partir de cualquier tipo de entrada.

Crear imágenes con inteligencia artificial ya no es novedad, pero la verdadera frontera se encuentra en la capacidad de modificar, dar continuidad y refinar una idea inicial hasta convertirla en algo más elaborado. En el ámbito del vídeo, este desafío es considerablemente mayor, involucrando movimiento, tiempo, física y la crucial coherencia de personajes y escenarios. Google DeepMind ha presentado Gemini Omni, un modelo de IA diseñado para abordar precisamente estos retos y simplificar drásticamente la edición de vídeo.
La comparación que hace Google DeepMind es reveladora: piensa en Gemini Omni como en Nano Banana, pero aplicado al vídeo. Nano Banana, lanzado en agosto de 2025, fue un generador de imágenes de IA que alcanzó una popularidad masiva, sumando 13 millones de usuarios en solo cuatro días y generando más de 5.000 millones de imágenes. Ahora, Gemini Omni Flash, la primera iteración de la familia Gemini Omni, se presenta con la ambición de llevar esa misma versatilidad y escala a la creación de contenido audiovisual.
Según la compañía, Gemini Omni Flash está concebido para crear contenido a partir de cualquier tipo de entrada. Esto significa que los usuarios podrán combinar imágenes, audio, vídeo y texto como punto de partida para generar vídeos de alta calidad. La clave reside en su capacidad para integrar el vasto conocimiento del mundo real que posee Gemini, asegurando una mayor coherencia y realismo en las creaciones.
La edición de vídeo con Gemini Omni se plantea no solo como una herramienta para generar clips desde cero, sino como un sistema interactivo capaz de trabajar sobre una escena existente mediante instrucciones detalladas. Google destaca la posibilidad de modificar elementos concretos o transformar por completo un vídeo de partida, ajustando aspectos como la estética, la acción, el entorno, el ángulo de cámara, el estilo o detalles específicos. Un punto fuerte es su promesa de mantener la consistencia de los personajes y la continuidad de la escena, ofreciendo además una física más creíble.
Los ejemplos de prompts compartidos ilustran el potencial de Gemini Omni. Instrucciones como “Haz que la escultura esté hecha de burbujas” o “Cuando la persona toque el espejo, haz que el espejo ondule con un efecto líquido y elegante, y que su brazo se convierta en un material reflectante” demuestran la granularidad y la potencia de control que ofrece el modelo. Incluso para explicaciones complejas, como un “explicador en claymation sobre el plegamiento de proteínas, todo hecho de arcilla, sin manos, en stop motion y con precisión”, Gemini Omni busca ofrecer resultados detallados y estilizados.
En cuanto a su disponibilidad, Google ha anunciado que Gemini Omni Flash ya está llegando a los suscriptores de Google AI Plus, Pro y Ultra a través de Gemini y Google Flow. Además, su despliegue gratuito en plataformas como YouTube Shorts y la aplicación YouTube Create App comenzará esta semana. Sin embargo, en pruebas corporativas se ha observado un límite de generación de tres vídeos hasta una fecha específica, lo que sugiere que Google está dosificando el acceso, dada la alta demanda de recursos computacionales que implica la generación de vídeo con IA.
La llegada de Gemini Omni se produce en un momento clave para la generación de vídeo con IA, donde competidores como OpenAI con Sora han generado gran expectación. Si bien Sora prometía mucho, su disponibilidad y resultados finales han sido objeto de debate, con su web y app dejando de estar disponibles a finales de abril de 2026, aunque su API continuará operativa hasta septiembre. Gemini Omni busca consolidarse como una alternativa robusta y accesible, integrándose en el ecosistema de Google para democratizar la creación de contenido audiovisual avanzado.

Seguí leyendo online — escaneá el código
https://go.tricuatro.com/fzpma
© tricuatro.com
Temas de la nota
Notas relacionadas

Chip del MIT convierte luz infrarroja invisible en información crucial
Investigadores del MIT desarrollaron un innovador chip que detecta metano y propano usando luz infrarroja media, con potencial para millones de píxeles y computación óptica.

TikTok prueba herramienta de IA para proteger creadores de deepfakes
La plataforma de videos está implementando una opción para que los usuarios verifiquen su identidad y reporten usos no autorizados de su imagen generados por inteligencia artificial.

Tesla Lanza Réplica Eléctrica del Cybertruck para Niños en EE. UU.
Tesla presenta su Cybertruck a escala para niños de 6 a 12 años, un vehículo eléctrico de USD 1.500 que por ahora solo está disponible en el mercado estadounidense.
Últimas noticias
Ver todas
Un dulce hallazgo interestelar: detectan eritrulosa en la Vía Láctea
Científicos del Centro de Astrobiología de España identificaron por primera vez un azúcar verdadero, la eritrulosa, en una nube de gas y polvo cerca del centro de nuestra galaxia. Este descubrimiento sugiere que moléculas complejas pueden formarse antes del nacimiento de estrellas y planetas.

Frenan fusión de Paramount y Warner Bros. por objeciones antimonopolio
Una coalición de 12 estados logró que la Jueza Araceli Martinez-Olguin detuviera temporalmente el acuerdo, citando preocupaciones sobre precios y oferta de contenido.

Assassin's Creed Black Flag Resynced Supera 3 Millones de Ventas y Anuncia New Game Plus
El exitoso relanzamiento del clásico pirata de Ubisoft continúa rompiendo récords, confirmando una de las funciones más solicitadas por la comunidad de jugadores.
Comentarios (0)
Aún no hay comentarios. ¡Sé el primero!
Solo los lectores registrados pueden comentar.