Publiziert:

Gemini (Google AI)

Gemini ist die KI-Plattform von Google. Sie umfasst verschiedene multimodale Modelle (u. a. Flash, Pro und weitere Varianten; Modellnamen ändern sich je Release), die nativ Text, Bild, Audio und Video verarbeiten können.


Kernkonzept

Tiefe Integration in das Google-Ökosystem. Gemini kann in passenden Konfigurationen auf Daten in Google Drive, Gmail und Docs zugreifen, um Aufgaben zu automatisieren. Das Modell unterstützt ein sehr grosses Kontextfenster (bis zu 2 Mio. Token).

Einschätzung

  • Einsatzbereich: Automatisierung von Office-Workflows, Analyse grosser Video- und Datenmengen und Modellalternative zu OpenAI.
  • Vorteil: Direkte Einbindung in Google Workspace, hohe Geschwindigkeit bei der Flash-Variante und multimodale Verarbeitung von Text, Bild, Audio und Video.
  • Limitierung: Datenschutzbedenken bei der Nutzung von Nutzerdaten für das Training (Enterprise-Einstellungen zwingend erforderlich).

Verwandte Themen

  • KI-Entwicklung, der Entwicklungskontext für KI-gestützte Arbeit mit Gemini.
  • GenAI und RAG, die Pipeline, in der Gemini praktisch eingesetzt wird.
  • OpenAI, der Servicevergleich zu Gemini.
  • Sprachmodelle, der Überblick über die Modell-Landschaft.