O rodzinie
Gemini to flagowa rodzina multimodalnych modeli AI rozwijana przez Google DeepMind, wprowadzona w grudniu 2023 roku (pierwotnie jako następca serii PaLM i Bard). Modele Gemini są zaprojektowane jako natywnie multimodalne od podstaw - przetwarzają tekst, obraz, audio, wideo i kod w jednej architekturze. Znane warianty rozmiarów: Ultra (najsilniejszy), Pro (balans), Flash (szybki/tani), Nano (on-device), Flash-Lite (najtańszy). Historyczne generacje: Gemini 1.0 (grudzień 2023), Gemini 1.5 z 1M/2M context window (luty 2024, breakthrough długiego kontekstu), Gemini 2.0 (grudzień 2024, natywna generacja obrazu, agentic tools), Gemini 2.5 (marzec 2025, thinking mode), Gemini 3 (2025, reasoning), Gemini 3.1 Pro / Flash-Lite / Deep Think (2026), Gemini 3.5 Flash (2026). Specjalistyczne warianty: Gemini Robotics 1.5 i Robotics-ER 1.6 (Vision-Language-Action dla robotyki), Gemini Robotics On-Device (edge inference dla robotów). Model dostępny w chatbot na gemini.google.com, Google Workspace (Gemini in Docs/Gmail/Sheets), Vertex AI (dla enterprise), Google AI Studio (dla developerów), Gemini API i Gemini CLI. Gemini Spark to agentowy wariant konsumencki. Konkurencja: ChatGPT/GPT-5 (OpenAI), Claude (Anthropic), Qwen (Alibaba), DeepSeek.
Modele
14 · 2024–2026
Gemini 3.5 FlashLLM · Model multimodalny · Model rozumowania +11M
Gemini 3.6 FlashLLM · Model multimodalny · Model rozumowania +11M
Gemini 3.7 FlashLLM · Model multimodalny · Model rozumowania +11M
Gemini 1.5 ProLLM · Model multimodalny · Model używający narzędzi1M (do 2M)
Gemini 2.0 FlashLLM · Model multimodalny · Model używający narzędzi +11M
Gemini 2.5 ProLLM · Model multimodalny · Model rozumowania +1do 1M tokenów
Gemini 3LLM · Model multimodalny · Model rozumowania +11M tokenów
Gemini 3 FlashLLM · Model multimodalny · Model rozumowania +11M
Gemini 3.1 Deep ThinkLLM · Model multimodalny · Model rozumowania1M
Gemini Robotics 1.5Model multimodalny · Bazowy model robotyczny · Model wzrok-język-akcja32K
Gemini Robotics On-DeviceBazowy model robotyczny · Model wzrok-język-akcja1088
Gemini Robotics-ER 1.6Model multimodalny · Bazowy model robotyczny128K
Gemini 3.1 Flash-LiteLLM · Model multimodalny · Model rozumowania +11M
Gemini 3.1 ProLLM · Model multimodalny · Model rozumowania +11M
