Guida per gli sviluppatori a Gemini 3.7 Flash

Gemini 3.7 Flash è il nostro modello intelligente di uso quotidiano per gli sviluppatori e rappresenta un passo avanti nell'ingegneria del software, con un'esperienza di sviluppo nettamente migliore. Questo modello offre una migliore intelligenza per attività complesse, il rispetto delle istruzioni e le chiamate di strumenti nei workflow quotidiani.

Questo documento illustra le novità di 3.7 Flash, come si inserisce nella famiglia di modelli Gemini, come eseguire la migrazione a 3.7 Flash e fornisce una guida rapida per l'utilizzo di 3.7 Flash.

Come si inserisce nella famiglia Gemini?

Gemini 3.7 Flash è il modello di riferimento per le attività agentiche nella famiglia Gemini 3, colmando il divario tra i modelli Pro con ragionamento approfondito e i modelli Gemini Flash-Lite ad alta velocità di elaborazione, offrendo al contempo un'elevata efficienza dei token ed elaborazione multimodale in più passaggi.

Specifiche e confronti dei modelli

La seguente tabella mette a confronto alcune delle specifiche di 3.7 Flash, 3.6 Flash e 3.1 Pro:

Gemini 3.7 Flash Gemini 3.6 Flash Gemini 3.1 Pro
ID modello gemini-3.7-flash gemini-3.6-flash gemini-3.1-pro-preview
Fase di lancio GA GA Anteprima
Tipi di input Testo, immagine, audio, video Testo, immagine, audio, video Testo, immagine, audio, video
Tipo/tipi di output Testo Testo Testo
Finestra contestuale 1.048.576 1.048.576 1.048.576
Lunghezza massima dei token di output 65.536 65.536 65.536
Aree geografiche supportate Globale, multiregionale Globale, multiregionale Globale
Livelli di ragionamento supportati LOW, MEDIUM, HIGH
(valore predefinito: MEDIUM)
MINIMAL, LOW, MEDIUM, HIGH
(valore predefinito: MEDIUM)
LOW, MEDIUM, HIGH
(valore predefinito: HIGH)
Scopo principale Workflow agentici, codifica, comprensione dei video interattivi Workflow agentici generali, orchestrazione in più passaggi Ragionamento approfondito, attività di elevata complessità

Per l'elenco completo delle funzionalità, degli strumenti e delle opzioni di consumo supportati, consulta la pagina del modello 3.7 Flash.

Novità di Gemini 3.7 Flash

La seguente tabella mette a confronto i benchmark di valutazione standard degli sviluppatori tra Gemini 3.7 Flash e 3.6 Flash:

Benchmark di valutazione 3.7 Flash 3.6 Flash
Terminal-bench 2.1 85,1% 73,0%
DeepSWE 63,7% 49,0%
Humanity's Last Exam (HLE) 45,7% 37,4%
LMArena WebDev 1592 1532

Guida rapida

Prima di iniziare, devi eseguire l'autenticazione ad Agent Platform utilizzando le credenziali predefinite dell'applicazione (ADC) o una chiave API. Per ulteriori informazioni, consulta la pagina Inizia a utilizzare Gemini Enterprise Agent Platform.

Nei seguenti blocchi di codice, sostituisci PROJECT_ID con il tuo ID progetto.

Installazione

Assicurati di utilizzare l'SDK google-genai più recente:

pip install --upgrade google-genai

Richiesta di base

Python

from google import genai

client = genai.Client(enterprise=True, project="PROJECT_ID", location="global")

response = client.models.generate_content(
  model="gemini-3.7-flash",
  contents="How does AI work?",
)
print(response.text)

REST

curl -X POST \
-H "Authorization: Bearer $(gcloud auth print-access-token)" \
-H "Content-Type: application/json" \
https://aiplatform.googleapis.com/v1/projects/PROJECT_ID/locations/global/publishers/google/models/gemini-3.7-flash:generateContent \
-d '{
  "contents": {
    "role": "USER",
    "parts": { "text": "Why is the sky blue?" },
  },
}'

Regole API e convenzioni comportamentali obbligatorie

Gemini 3.7 Flash applica rigorosamente le seguenti convenzioni API standard della famiglia Gemini 3:

  • Parametri di campionamento obsoleti (temperature, top_k, top_p): questi parametri vengono ignorati dal backend. In alternativa, puoi controllare il determinismo utilizzando thinking_level (LOW, MEDIUM, HIGH) e response_schema o json_schema.
  • Parametri non supportati (frequency_penalty, presence_penalty, candidate_count): se passi frequency_penalty, presence_penalty o candidate_count, viene generato un errore API attivo. Rimuovili dal codice client legacy.
  • Regole di chiamata di funzioni rigorose: un turno FunctionResponse deve corrispondere esattamente a id, name e al conteggio di esecuzione del FunctionCall.

    • Asset multimodali: inserisci sempre gli asset multimodali nel payload della risposta.
    • Formattazione e testo pre-strumento: formatta le istruzioni in linea utilizzando \n\n. Se riscontri errori Malformed_Function_Call relativi al testo pre-strumento, pulisci i commenti iniziali prima delle chiamate di strumenti.
    • Per passare note di lavoro intermedie o aggiornamenti di stato prima di una chiamata di strumenti, racchiudili in una chiamata di funzione update() dedicata anziché emettere XML o testo non elaborato:

      {
        "name": "update",
        "description": "Update working notes before tool execution",
        "parameters": {
          "type": "OBJECT",
          "properties": {
            "previous_step": {"type": "STRING"},
            "plan": {"type": "STRING"},
            "next_step": {"type": "STRING"}
          },
          "required": ["previous_step", "plan", "next_step"]
        }
      }
      
  • Convalida della sequenza di chat:

    • I payload della cronologia non possono terminare con un turno di ruolo "model".
    • I turni del modello precompilati non sono supportati e devono essere rimossi durante l'upgrade.
    • I turni vuoti nella cronologia delle conversazioni vengono eliminati automaticamente o generano errori di convalida.

Eseguire la migrazione a 3.7 Flash da 3.5 Flash o 3.6 Flash

Per eseguire la migrazione a 3.7 Flash da 3.5 Flash o 3.6 Flash:

  1. Aggiorna l'ID modello: modifica la stringa del modello nelle chiamate API in gemini-3.7-flash.
  2. Sostituisci il parametro del budget di ragionamento: sostituisci le configurazioni intere thinking_budget con l'enumerazione di stringhe thinking_level impostata su uno dei seguenti valori:
    • HIGH: consigliato per QA visiva densa, rilevamento di movimenti in frazioni di secondo (sport, editing) o ragionamento multi-step su video di oltre 60 minuti.
    • MEDIUM: il livello di ragionamento predefinito. Questo livello offre un equilibrio ottimale per le domande e risposte video generali, il riepilogo delle lezioni e il recupero dei clip.
    • LOW: consigliato per attività come ricerche rapide incentrate sulle trascrizioni o estrazione di metadati di base.
  3. Rimuovi i parametri obsoleti e non supportati:
    • Rimuovi temperature, top_p e top_k.
    • Rimuovi candidate_count, frequency_penalty e presence_penalty.
    • Rimuovi tutti i turni del modello precompilati dalle cronologie delle conversazioni.

Elenco di controllo riepilogativo per gli sviluppatori

Risorse aggiuntive