Google I/O 2024: Gemini 1.5, agentes IA y todas las novedades de este evento
Actualizado: 1 junio, 2024
En una presentación llena de novedades y anuncios impactantes, Google ha dado inicio a su evento anual Google I/O 2024. Este año, el enfoque principal ha sido la era Gemini, marcando un antes y un después en la integración de la inteligencia artificial en todas sus plataformas y productos. Con una visión clara hacia el futuro, Google ha destacado cómo la IA está transformando cada aspecto de la tecnología y mejorando la vida de millones de usuarios en todo el mundo.
Google I/O 2024 y la era Gemini 1.5
La piedra angular de Google I/O 2024 ha sido la presentación de Gemini 1.5 Pro, un modelo de IA multimodal capaz de razonar a través de texto, imágenes, video, y código. Gemini promete revolucionar la forma en que interactuamos con la tecnología, proporcionando respuestas más precisas y relevantes. Según Sundar Pichai, CEO de Google, Gemini representa «un gran paso para convertir cualquier entrada en cualquier salida, un ‘I/O’ para una nueva generación».
El modelo Gemini 1.5 Pro, uno de los más avanzados hasta la fecha, puede manejar hasta un millón de tokens en producción, superando cualquier otro modelo de IA a gran escala. Esto abre un abanico de posibilidades para desarrolladores y usuarios, permitiendo aplicaciones más complejas y útiles.
Integración de Gemini en productos de Google
Todos los productos de Google, utilizados por más de 2000 millones de usuarios, ya están incorporando las capacidades de Gemini. Desde el Buscador hasta Google Fotos y Workspace, la IA está optimizando la experiencia del usuario de maneras sin precedentes.
Transformaciones en el buscador
Uno de los desarrollos más destacados es la transformación del Buscador de Google. La nueva Experiencia Generativa de Búsqueda (SGE) ha sido un éxito, respondiendo a miles de millones de consultas con mayor precisión y eficiencia. Google ha introducido «Resumen Creado con IA», una función que proporcionará a los usuarios resúmenes detallados y generados por IA de sus búsquedas.
Google Fotos: recordando con precisión
Google Fotos, una herramienta esencial para organizar recuerdos, ahora incorpora Gemini para facilitar búsquedas más profundas. La nueva función «Ask Photos» permite a los usuarios realizar consultas complejas sobre sus fotos y obtener respuestas precisas y contextuales. Esta herramienta estará disponible a partir de este verano.
Avances en Google Workspace
Gemini también está mejorando la productividad en Google Workspace. Con la capacidad de resumir correos electrónicos y extraer información clave de archivos adjuntos, Gemini facilita la gestión de la comunicación y tareas diarias. Esta integración está disponible en Workspace Labs y promete hacer la vida más fácil para millones de usuarios.
Proyecto Astra
Para explotar al máximo el potencial de la inteligencia artificial, Google DeepMind ha estado trabajando arduamente en nuevas innovaciones. Uno de los lanzamientos más esperados es el modelo Gemini 1.5 Flash, diseñado para ser más rápido y rentable, ideal para tareas que requieren baja latencia. Este modelo estará disponible en AI Studio y Vertex AI a partir del martes.
Además, Google ha revelado el Proyecto Astra, un agente universal con comprensión multimodal y capacidades conversacionales en tiempo real. En el ámbito de la generación de contenido, se han realizado avances significativos con Veo e Imagen 3, y se ha presentado Gemma 2.0, la nueva generación de modelos abiertos enfocados en la innovación responsable en IA.
Expansión de las capacidades multimodales
Gemini ha sido diseñado desde el inicio para ser multimodal, permitiendo la integración y comprensión de múltiples tipos de datos. Esto se traduce en respuestas más completas y contextualizadas. La expansión a 2 millones de tokens en vista previa privada abre nuevas posibilidades para aplicaciones aún más avanzadas.
NotebookLM: respuestas de audio personalizadas
NotebookLM, impulsado por Gemini, permite la generación de resúmenes de audio personalizados a partir de materiales de origen. Esta funcionalidad representa un avance significativo en la manera en que consumimos y procesamos información.
Google también ha presentado su visión para los agentes de IA, sistemas inteligentes capaces de planificar y realizar tareas complejas de manera autónoma. Desde gestionar devoluciones de compras hasta organizar la vida en una nueva ciudad, estos agentes prometen simplificar muchas tareas cotidianas y estarán integrados en un futuro cercano en dispositivos móviles y gafas virtuales de Google.
Infraestructura para la era de la IA
Para soportar estos avances, Google ha anunciado la sexta generación de sus Unidades de Procesamiento Tensorial (TPU), denominadas Trillium. Estas TPU son las más eficientes y potentes hasta la fecha, multiplicando por 4,7 el rendimiento computacional de su generación anterior. Además de las TPU, Google está colaborando con NVIDIA para ofrecer las nuevas GPU Blackwell y ha introducido sus primeros procesadores personalizados basados en Arm, conocidos como Axion. Estas innovaciones aseguran que Google Cloud permanezca a la vanguardia de la infraestructura tecnológica.
Un enfoque responsable y seguro en la IA
Google reafirma su compromiso con el desarrollo responsable de la IA. La técnica «Red Teaming» asistida por IA y las innovaciones en marcas de agua para identificar contenido generado por IA son pasos importantes para garantizar la seguridad y la integridad de la información.
Google I/O 2024 ha dejado claro que la era Gemini está aquí para quedarse. Con avances significativos en inteligencia artificial, integración de productos y una infraestructura robusta, Google está preparado para liderar la próxima generación de innovación tecnológica. Este evento no solo ha mostrado el poder de la IA, sino también cómo puede transformar la vida de millones de personas de manera positiva y significativa.
También te puede interesar: GPT-4o, la IA más avanzada de OpenAI: puede hablar, traducir en tiempo real y más