Zum Hauptinhalt springen
Google Cloud Documentation
Dokumentation
  • Jetzt starten
  • Erste Schritte mit Google Cloud
  • Produktliste
  • Cloud Customer Care
  • Vorgestellte Produkte
  • Agent Platform
  • API-Verwaltung mit Apigee
  • BigQuery
  • Compute Engine
  • Cloud CDN
  • Cloud Run
  • Cloud Storage
  • Cloud SQL
  • Gemini Enterprise
  • Google Kubernetes Engine
  • Looker
  • Produktübergreifende Tools
  • Zugriffs- und Ressourcenverwaltung
  • Kosten- und Nutzungsmanagement
  • Infrastruktur als Code
  • SDK, Sprachen, Frameworks und Tools
  • Technologiebereiche
  • KI und ML
  • Anwendungsentwicklung
  • Anwendungshosting
  • Compute
  • Datenanalyse und Pipelines
  • Datenbanken
  • Verteilt, Hybrid und Multi-Cloud
  • Branchenlösungen
  • Migration
  • Netzwerk
  • Beobachtbarkeit und Monitoring
  • Sicherheit
  • Storage
/
Console
  • English
  • Deutsch
  • Español – América Latina
  • Français
  • Indonesia
  • Italiano
  • Português – Brasil
  • עברית
  • 中文 – 简体
  • 中文 – 繁體
  • 日本語
  • 한국어
  • Gemini Enterprise Agent Platform
Jetzt kostenlos testen
Übersicht Studio Agenten Modelle Notebooks
  • Agent Platform
  • Generative KI
Engineering-Blog
Google Cloud Documentation
  • Dokumentation
    • Mehr
    • Übersicht
    • Studio
    • Agenten
    • Modelle
    • Notebooks
    • Preise
      • Mehr
    • Engineering-Blog
  • Console
  • Übersicht
  • Erste Schritte
  • Los gehts
  • Erste Schritte mit der Agent Platform
  • Gemini API-Code mit dem Gen AI SDK entwickeln
  • Verbindung zum Knowledge-MCP-Server herstellen
  • API-Schlüssel abrufen
  • Standardanmeldedaten für Anwendungen konfigurieren
  • Von Google AI Studio zur Agent Platform migrieren
  • Erste Schritte mit Gemini 3
  • Entwicklerleitfäden für Gemini-Modelle
    • Gemini 3.8 Flash
    • Gemini 3.7 Flash
    • Gemini 3.6 Flash
    • Gemini 3.5 Flash
  • Google GenAI-Bibliotheken
  • Kochbuch für generative KI
  • Mit OpenAI-Bibliotheken auf Gemini-Modelle zugreifen
  • Expressmodus
    • Übersicht
    • Tutorial in der Console
    • API-Anleitung
  • Modelle auswählen
    • Model Garden
    • Übersicht über Model Garden
    • Modelle in Model Garden verwenden
    • Modellfunktionen testen
    • Google-Modelle
    • Alle Google-Modelle
    • Gemini
      • Auf die neuesten Gemini-Modelle migrieren
      • Pro
      • 3.1 Pro
      • 3 Pro Image
      • 2.5 Pro
      • Blitz
      • 3.8 Flash
      • 3.7 Flash
      • 3.6 Flash
      • 3.5 Flash
      • 3.1 Flash-Image
      • 3 Flash
      • 2.5 Flash
      • 2.5 Flash Image
      • 2.5 Flash Live API
      • Flash-Lite
      • 3.5 Flash-Lite
      • 3.1 Flash-Lite-Bild
      • 3.1 Flash-Lite
      • 2.5 Flash-Lite
      • Omni
      • Omni 1.1 Flash
      • Omni Flash
      • Cyber
      • 3.8 Flash Cyber
      • Transkribieren
      • Gemini 3.5 Transcribe
      • Übersetzen
      • Gemini 3.5 Live-Übersetzung
      • Einbetten
      • Gemini Embedding 2
      • Robotertechnik
      • Gemini Robotics ER 2
        • Übersicht
        • Räumliches Denken
        • Agentische Funktionen
        • Aufgabenorchestrierung
        • Videos verstehen
    • Veo
      • Veo 3
      • Veo 3.1
    • Lyria
      • Lyria 2
      • Lyria 3
    • Virtueller Test
    • Modellversionen
    • Partnermodelle
    • Übersicht über Partnermodelle
    • Claude
      • Übersicht
      • Vorhersagen anfragen
      • Kontingente für Anthropic Claude-Modelle
      • Batchvorhersagen
      • Strukturierte Ausgaben
      • Prompt-Caching
      • Tokens zählen
      • Websuche
      • Sicherheitsklassifikatoren
      • Cyber Verification Program
      • Modelldetails
      • Claude Fable 5.1
      • Claude Opus 5
      • Claude Sonnet 5
      • Claude Fable 5
      • Claude Opus 4.8
      • Claude Opus 4.7
      • Claude 4.6 Sonnet
      • Claude Opus 4.6
      • Claude Opus 4.5
      • Claude Sonnet 4.5
      • Claude Opus 4.1
      • Claude Haiku 4.5
      • Claude Opus 4
      • Claude Sonnet 4
    • Grok
      • Übersicht
      • Responses API
      • Funktionsaufrufe
      • Strukturierte Ausgabe
      • Schlussfolgerungen ziehen
      • Modelldetails
      • Grok 4.1 Fast
      • Grok 4.20
      • Grok 4.3
      • Grok 4.6
    • Mistral AI
      • Übersicht
      • Modelldetails
      • Mistral Medium 3
      • Mistral OCR (25.05)
      • Mistral Small 3.1 (25.03)
      • Codestral 2
    • Partnermodelle aus Model Garden bereitstellen
    • Einstellung von Partnermodellen
    • Offene Modelle
    • Übersicht
    • AlphaFold 3
    • AlphaGenome
    • DeepSeek
      • Übersicht
      • DeepSeek-V3.2
      • DeepSeek-V3.1
      • DeepSeek-R1-0528
      • DeepSeek-OCR
    • Einbettung (e5)
      • Mehrsprachig E5 Small
      • Mehrsprachig E5 Large
    • Google Gemma
      • Model-as-a-Service (MaaS)
      • Gemma-4-26B-A4B-IT MaaS
      • Gemma verwenden
      • Anleitung: Gemma bereitstellen und Inferenz durchführen (GPU)
      • Anleitung: Gemma bereitstellen und Inferenz durchführen (TPU)
    • Kimi
      • Übersicht
      • Kimi K2 Thinking
    • Llama 3
      • Übersicht
      • Vorhersagen anfragen
      • Modelldetails
      • Llama 4 Maverick
      • Llama 4 Scout
      • Llama 3.3
    • MiniMax
      • Übersicht
      • MiniMax M2
    • OpenAI
      • Übersicht
      • OpenAI gpt-oss-120b
      • OpenAI gpt-oss-20b
    • Qwen
      • Übersicht
      • Qwen 3 Next Instruct 80B
      • Qwen 3 Next Thinking 80B
      • Qwen 3 Coder
      • Qwen 3 235B
    • ZAI.org
      • Übersicht
      • GLM 5.2
      • GLM 5
      • GLM 4.7
    • Verwaltete offene Modelle (MaaS)
      • Übersicht
      • Offene Modelle über Model as a Service (MaaS) verwenden
      • Zugriff auf offene Modelle gewähren
      • API
      • MaaS-APIs für offene Modelle aufrufen
      • Funktionsaufrufe
      • Wird generiert
      • Strukturierte Ausgabe
      • Batchvorhersage
      • Auslaufende Modelle
    • Selbst bereitgestellte offene Modelle
      • Übersicht
      • Offene Modelle bereitstellen
        • Offene Modelle aus Model Garden bereitstellen
        • Offene Modelle mit vordefinierten Containern bereitstellen
        • Offene Modelle mit einem benutzerdefinierten vLLM-Container bereitstellen
        • Modelle mit benutzerdefinierten Gewichtungen bereitstellen
      • Hugging Face-Modelle verwenden
      • Anleitungen
        • Modellleistung mit erweiterten Funktionen in Model Garden optimieren
        • Hex-LLM
        • Umfassender Leitfaden zu vLLM für die Bereitstellung von Text- und multimodalen LLMs (GPU)
        • vLLM TPU
        • xDiT
        • Llama 3-Modelle mit Spot-VMs und Reservierungen bereitstellen
  • Build
    • Prompt-Design
    • Einführung in die Prompts
    • Prompt-Strategien
      • Übersicht
      • Klare und spezifische Anleitung geben
      • Systemanweisung verwenden
      • Few-Shot-Beispielen einfügen
      • Kontextinformationen hinzufügen
      • Prompts strukturieren
      • Prompts vergleichen
      • Weisen Sie das Modell an, seine Logik zu erklären.
      • Komplexe Aufgaben aufschlüsseln
      • Mit Parameterwerten experimentieren
      • Strategien für Prompt-Iteration