Google presenta Gemini, su modelo multimodal “de frontera”
El 6 de diciembre de 2023 Google DeepMind anunció Gemini 1.0, diseñado desde el inicio para procesar texto, imágenes, audio, video y código de forma nativa, en tres tamaños: Ultra, Pro y Nano. Gemini Ultra reclamó superar a GPT-4, Claude 2, LLaMA 2 y Grok 1 en varios benchmarks, y fue el primer modelo en superar a expertos humanos en la prueba MMLU de 57 materias (90%). En febrero de 2024 llegó Gemini 1.5, con ventana de contexto de un millón de tokens y arquitectura mixture-of-experts.
Anunciado por Google DeepMind el 6-dic-2023; el despliegue público (integrado luego en el producto renombrado Gemini) comenzó el 8-feb-2024.
Por qué es un hito
Consolidó a Google como competidor directo de OpenAI y Anthropic en modelos de frontera multimodales, e instaló la ventana de contexto masiva y el diseño “multimodal desde el origen” como nuevos estándares de la industria.
Actores
Tecnologías
Geografía
Fuentes
- Gemini (language model) (artículo)Wikipedia · 2026 VerificadaVer fuente
Antecedentes
Conceptos relacionados
Referencias al glosario del medio (en preparación).