Gemini Embedding 2

Gemini Embedding 2 ist das Modell von Google zur Generierung von Einbettungen, das sich ideal für komplexe Abruf- und Analyseaufgaben eignet.

Gemini Embedding 2 akzeptiert multimodale Eingaben, um 3.072-dimensionale Vektoren zu generieren. Das Modell akzeptiert Bilder, Text, Dokumente, Audio und Video als Eingabe und ordnet die generierten Vektoren semantisch einem einheitlichen semantischen Raum zu. So können Sie beispielsweise nach einem Bild anhand einer Textbeschreibung suchen.

Gemini Embedding 2 bietet mehrere Funktionen zur Optimierung von Embedding-Qualität und ‑Flexibilität:

  • Benutzerdefinierte Aufgabenanweisungen:Wenn Sie Aufgabenanweisungen angeben (z. B. task:code retrieval oder task:search result), werden die Einbettungen für die beabsichtigten Beziehungen optimiert und Sie erhalten genauere Ergebnisse für das jeweilige Ziel.

  • Anpassbare Ergebnisgröße:Das Modell generiert standardmäßig einen 3.072-dimensionalen Gleitkommavektor. Sie können jedoch eine Ausgabe mit weniger Dimensionen abrufen, indem Sie den Parameter output_dimensionality angeben.

  • Document OCR:OCR aus Dokumenteingaben lesen.

  • Audiotrack-Extraktion:Audiotracks aus Videoeingaben extrahieren und mit Videoframes verschachteln.

Weitere Informationen zur Verwendung von Gemini Embedding 2 finden Sie unter Multimodale Einbettungen abrufen.

Preise

Modell-ID gemini-embedding-2
Betriebsarten
Text Nur Eingabe
Bild Nur Eingabe
Audio Nur Eingabe
Video Nur Eingabe
Embeddings Nur Ausgabe
Token limits Maximale Anzahl der Eingabetokens 8.192
Maximale Ausgabetokens –
Ausgabedimensionen Bis zu 3.072 (mit MRL-Unterstützung)
Maximale Sequenzlänge 8.192 Tokens
Nutzungsoptionen
Technische Spezifikationen Text
  • Maximale Eingabetokens: 8.192
  • Maximale Anzahl von Dateien pro Prompt: 1
  • Maximale Anzahl von Seiten pro Datei (für PDF): 6
  • Maximale Dateigröße pro Datei: –
  • OCR für gescannte PDFs: Wird nicht standardmäßig verwendet
  • Unterstützte MIME-Typen:
    text/plain, application/pdf
Bild
  • Maximale Anzahl von Bildern pro Prompt: 6
  • Maximale Dateigröße pro Datei für Inline-Daten oder direkte Uploads über die Console: Kein Limit
  • Maximale Dateigröße pro Datei aus Google Cloud Storage: Keine Beschränkung
  • Maximale Anzahl von Ausgabebildern pro Prompt: N/A
  • Unterstützte MIME-Typen:
    image/png, image/jpeg, image/webp, image/bmp, image/heic, image/heif, image/avif
Video
  • Maximale Videolänge (mit Audio): 80 Sekunden
  • Maximale Videolänge (ohne Audio): 120 Sekunden
  • Maximale Anzahl von Videos pro Prompt: 1
  • Unterstützte MIME-Typen:
    video/mpeg, video/mp4
Audio
  • Maximale Audiolänge pro Prompt: 180 Sekunden
  • Maximale Anzahl von Audiodateien pro Prompt: 1
  • Unterstützte MIME-Typen:
    audio/mp3, audio/wav
Unterstützte Regionen

Modellverfügbarkeit

  • Global: global
  • USA (mehrere Regionen): us
  • Europa (mehrere Regionen): eu
Wissensstichtag November 2025
Versionen
  • gemini-embedding-2
    • Einführungsphase: GA
    • Veröffentlichungsdatum: 22. April 2026
  • gemini-embedding-2-preview
    • Einführungsphase: Öffentliche Vorschau
    • Veröffentlichungsdatum: 10. März 2026