Ir al contenido principal
Volver a la línea de tiempo
Estados Unidos
Documentado

Google presenta Gemini, su modelo multimodal “de frontera”

El 6 de diciembre de 2023 Google DeepMind anunció Gemini 1.0, diseñado desde el inicio para procesar texto, imágenes, audio, video y código de forma nativa, en tres tamaños: Ultra, Pro y Nano. Gemini Ultra reclamó superar a GPT-4, Claude 2, LLaMA 2 y Grok 1 en varios benchmarks, y fue el primer modelo en superar a expertos humanos en la prueba MMLU de 57 materias (90%). En febrero de 2024 llegó Gemini 1.5, con ventana de contexto de un millón de tokens y arquitectura mixture-of-experts.

Anunciado por Google DeepMind el 6-dic-2023; el despliegue público (integrado luego en el producto renombrado Gemini) comenzó el 8-feb-2024.

Por qué es un hito

Consolidó a Google como competidor directo de OpenAI y Anthropic en modelos de frontera multimodales, e instaló la ventana de contexto masiva y el diseño “multimodal desde el origen” como nuevos estándares de la industria.

Actores

Google DeepMind

Tecnologías

modelo multimodal texto-imagen-audio-videomixture-of-expertscontexto de un millón de tokens

Geografía

Estados Unidos

Fuentes

  1. Gemini (language model) (artículo)Wikipedia · 2026 Verificada
    Ver fuente

Conceptos relacionados

Modelo fundacionalContextoMixture of experts

Referencias al glosario del medio (en preparación).

Un medio de señales del futuro: observa lo que está cambiando en tecnología, ciencia, regulación y sociedad, y lo publica como noticia, análisis o tesis de futuro. Cada pieza cita sus fuentes.

© 2026 HumanOS Future · medio de Sinapsis SpA. Las piezas de tipo tesis y opinión no son hechos consumados.