Publiziert:
Gemini (Google AI)
Gemini ist die KI-Plattform von Google. Sie umfasst verschiedene multimodale Modelle (u. a. Flash, Pro und weitere Varianten; Modellnamen ändern sich je Release), die nativ Text, Bild, Audio und Video verarbeiten können.
Kernkonzept
Tiefe Integration in das Google-Ökosystem. Gemini kann in passenden Konfigurationen auf Daten in Google Drive, Gmail und Docs zugreifen, um Aufgaben zu automatisieren. Das Modell unterstützt ein sehr grosses Kontextfenster (bis zu 2 Mio. Token).
Einschätzung
- Einsatzbereich: Automatisierung von Office-Workflows, Analyse grosser Video- und Datenmengen und Modellalternative zu OpenAI.
- Vorteil: Direkte Einbindung in Google Workspace, hohe Geschwindigkeit bei der Flash-Variante und multimodale Verarbeitung von Text, Bild, Audio und Video.
- Limitierung: Datenschutzbedenken bei der Nutzung von Nutzerdaten für das Training (Enterprise-Einstellungen zwingend erforderlich).
Verwandte Themen
- KI-Entwicklung, der Entwicklungskontext für KI-gestützte Arbeit mit Gemini.
- GenAI und RAG, die Pipeline, in der Gemini praktisch eingesetzt wird.
- OpenAI, der Servicevergleich zu Gemini.
- Sprachmodelle, der Überblick über die Modell-Landschaft.