Skip to main content
  1. Home
  2. Android
  3. Noticias
  4. News

Gemini Omni ahora puede extender los vídeos hasta 40 segundos y escalarlos a 4K

Add as a preferred source on Google
Adult, Female, Person
DTES

Generar un vídeo corto de IA es una cosa; Conseguir que varias tomas parezcan que realmente pertenecen al mismo vídeo es un problema mucho más difícil. Google está intentando de nuevo con Gemini Omni 1.1 Flash, su último modelo de vídeo generativo destinado a dar a creadores y desarrolladores mucho más control sobre lo que ocurre entre el primer fotograma y el último.

El mayor cambio es cuánto de un vídeo existente puede recordar Gemini cuando le pides que continúe una escena. Omni 1.1 puede consultar hasta 10 segundos de metraje anterior para obtener contexto, en lugar de depender solo del último segundo. Eso debería ayudar a mantener más coherentes a los personajes, los entornos y la dirección general de una escena en lugar de adivinar efectivamente qué debería pasar después.

Tus vídeos de IA no tienen que terminar tan rápido

Google también está dando a los creadores mucho más margen para mantener esas escenas. Los vídeos pueden extenderse en bloques de 10 segundos hasta alcanzar una duración total de 40 segundos. Puede que no suene especialmente largo comparado con un vídeo tradicional, pero abre mucho más espacio para secuencias generadas por IA con un principio, un desarrollo y un final reales.

Los creadores también pueden proporcionar tanto el primer como el último fotograma que desean para una toma. Géminis entonces genera todo lo necesario para conectar ambos. Eso podría ser útil para crear un movimiento de cámara alrededor de un sujeto, hacer zoom suave entre composiciones o construir un clip diseñado para repetirse sin un salto evidente. También se admiten referencias de vídeo. Puedes alimentar a Gemini hasta tres segundos de metraje existente para darle al modelo contexto visual adicional, lo que Google dice que debería ayudar a mantener aspectos como la apariencia de los personajes a través de las escenas generadas.

No necesitas renderizar todo en 4K

No todos los experimentos tienen que empezar con la máxima calidad, y una de las incorporaciones más prácticas de Omni 1.1 reconoce exactamente eso. Los desarrolladores pueden generar previsualizaciones en 360p que Google afirma que son hasta un 60% más rápidas que su salida habitual en 720p, y que cuestan aproximadamente un tercio de lo que salen. Eso facilita probar rápidamente una idea, ajustar prompts o avanzar en varias versiones antes de invertir más tiempo y dinero en el resultado final. Cuando estés satisfecho, Omni 1.1 puede producir metraje a 1080p o escalar el vídeo final hasta 4K.

La empresa ya está poniendo Omni 1.1 Flash a disposición de los desarrolladores a través de la API Gemini en Google AI Studio, mientras que las empresas pueden acceder a él a través de la plataforma Agent empresarial de Google. Tampoco es necesario que estés creando una app para probar algunos de estos trucos. Omni 1.1 se está desplegando globalmente en Google Flow para suscriptores de AI Plus, Pro y Ultra. La extensión de escenas también llegará directamente a los suscriptores dentro de la app Gemini, haciendo que una de las nuevas capacidades más interesantes del modelo sea considerablemente más fácil de probar.

Diego Bastarrica
Diego Bastarrica es Senior Editor y Head of Content en Digital Trends en Español, donde lidera la estrategia editorial, SEO…
Google DeepMind presenta un mapa con IA de todo el genoma humano
Genoma

Google DeepMind dio a conocer AlphaGenome Atlas, una nueva herramienta impulsada por inteligencia artificial que promete convertirse en un recurso clave para la investigación genética a nivel mundial. La plataforma reúne predicciones sobre los efectos moleculares de prácticamente los nueve mil millones de variaciones de una sola letra que pueden ocurrir en el ADN humano, en lo que la compañía describe como el catálogo más completo jamás creado sobre el impacto de las mutaciones genéticas en la biología celular.

Un catálogo construido a partir de un modelo ya existente

Read more
Google Translate estrena modo en segundo plano para Live Translate en Android
Google Translate

Google está desplegando una actualización relevante para su aplicación Translate que permite usar el modo Live Translate en segundo plano en dispositivos Android. Con este cambio, las sesiones de traducción en tiempo real ya no se interrumpen al cambiar de aplicación, minimizar la herramienta o bloquear la pantalla del teléfono.

La compañía confirmó que la función llega primero a Android porque más de un tercio de las sesiones de Live Translate superan los cinco minutos de duración. En ese contexto, poder multitarea sin perder el hilo de la conversación resulta especialmente útil para viajeros, estudiantes o profesionales que necesitan consultar mapas, correos u otras apps mientras mantienen activa la traducción.

Read more
Google ahora te permite chatear con Gmail, Docs y Keep
Gmail Live

Google ha comenzado a desplegar esta semana tres nuevas funciones de voz impulsadas por Gemini que transforman la interacción con Gmail, Docs y Keep. Bajo los nombres de Gmail Live, Docs Live y Keep Live, estas herramientas permiten a los usuarios gestionar sus aplicaciones mediante conversaciones naturales, ideal para quienes necesitan trabajar en movimiento o sin usar las manos.

Gmail Live actúa como un asistente conversacional para el correo: basta con preguntar, por ejemplo, “¿cuándo es el próximo evento escolar de mi hijo?” y la IA buscará en la bandeja de entrada, resumirá la información y mostrará los correos fuente en un transcript en pantalla. Docs Live, por su parte, funciona como un colaborador de escritura en tiempo real, capaz de generar borradores estructurados a partir de descripciones verbales y de integrar datos desde Gmail, Drive, Chat o la web. Keep Live convierte “descargas de ideas” en notas organizadas, como añadir ingredientes a una lista de compras solo con mencionarlos.

Read more