IA y modelos
Google actualiza la aplicación Gemini con nuevos agentes de IA y herramientas de video
Google actualizó su aplicación Gemini con una nueva interfaz, un agente de inteligencia artificial (IA) 24/7 llamado Gemini Spark y el modelo de video Gemini Omni para competir con ChatGPT y Claude.
En su evento anual Google I/O del martes, Google anunció una renovación importante de su aplicación Gemini, presentando una serie de actualizaciones diseñadas para transformar la aplicación de un chatbot independiente a un centro de IA de propósito general. Las actualizaciones incluyen una interfaz de usuario rediseñada, una nueva función “Daily Brief”, un agente de IA personal llamado Gemini Spark y acceso a un nuevo modelo de video de IA llamado Gemini Omni. Estas actualizaciones señalan el impulso de Google para hacer que el asistente Gemini sea más competitivo frente a aplicaciones de IA rivales como ChatGPT y Claude. La nueva función Daily Brief está diseñada para priorizar tareas y sugerir los siguientes pasos, y Google está lanzando esta función hoy para los suscriptores de Google AI en Estados Unidos.
La aplicación Gemini ya tiene un alcance amplio, sirviendo a más de 900 millones de usuarios mensuales en más de 230 países y admitiendo más de 70 idiomas. Para actualizar la aplicación, Google la reconstruyó desde cero utilizando un nuevo lenguaje de diseño llamado “Neural Expressive”. Esta actualización de interfaz se aleja de los muros de texto estándar típicos de los chatbots de IA. En cambio, la aplicación rediseñada presenta información clave en negrita en la parte superior de la pantalla, mientras que el texto adicional y otros elementos aparecen a medida que el usuario se desplaza hacia abajo.
Una adición clave a la plataforma es Gemini Spark, un agente de IA personal 24/7 diseñado para trabajar en segundo plano en nombre del usuario. Debido a que Gemini Spark está basado en la nube, continúa ejecutándose incluso cuando el dispositivo móvil del usuario está bloqueado. Google espera que Gemini Spark esté disponible la próxima semana para los suscriptores de Google AI Ultra, que es el nivel de suscripción premium de pago de la empresa.
Además, Google está integrando Gemini Omni, un nuevo modelo de video de IA que combina Gemini con modelos de medios generativos para producir resultados basados en conocimiento. Este modelo permite a los usuarios cargar audio, imágenes y video para generar contenido de video consistente. Gemini Omni se está implementando en Google Flow y YouTube Shorts para los suscriptores de Google AI, apoyando el impulso más amplio de la empresa hacia la creación de contenido multimodal.
Por qué importa
Google está evolucionando Gemini de un simple chatbot a un centro de IA multimodal y proactivo, desafiando directamente el dominio de mercado de ChatGPT y Claude al integrarse más profundamente en los flujos de trabajo de los usuarios.