Gemini 3.7 Flash è il nostro modello intelligente di uso quotidiano per gli sviluppatori e rappresenta un passo avanti nell'ingegneria del software, con un'esperienza di sviluppo nettamente migliore. Questo modello offre una migliore intelligenza per attività complesse, il rispetto delle istruzioni e le chiamate di strumenti nei workflow quotidiani.
Questo documento illustra le novità di 3.7 Flash, come si inserisce nella famiglia di modelli Gemini, come eseguire la migrazione a 3.7 Flash e fornisce una guida rapida per l'utilizzo di 3.7 Flash.
Come si inserisce nella famiglia Gemini?
Gemini 3.7 Flash è il modello di riferimento per le attività agentiche nella famiglia Gemini 3, colmando il divario tra i modelli Pro con ragionamento approfondito e i modelli Gemini Flash-Lite ad alta velocità di elaborazione, offrendo al contempo un'elevata efficienza dei token ed elaborazione multimodale in più passaggi.
Specifiche e confronti dei modelli
La seguente tabella mette a confronto alcune delle specifiche di 3.7 Flash, 3.6 Flash e 3.1 Pro:
| Gemini 3.7 Flash | Gemini 3.6 Flash | Gemini 3.1 Pro | |
|---|---|---|---|
| ID modello | gemini-3.7-flash |
gemini-3.6-flash |
gemini-3.1-pro-preview |
| Fase di lancio | GA | GA | Anteprima |
| Tipi di input | Testo, immagine, audio, video | Testo, immagine, audio, video | Testo, immagine, audio, video |
| Tipo/tipi di output | Testo | Testo | Testo |
| Finestra contestuale | 1.048.576 | 1.048.576 | 1.048.576 |
| Lunghezza massima dei token di output | 65.536 | 65.536 | 65.536 |
| Aree geografiche supportate | Globale, multiregionale | Globale, multiregionale | Globale |
| Livelli di ragionamento supportati |
LOW, MEDIUM, HIGH(valore predefinito: MEDIUM)
|
MINIMAL, LOW, MEDIUM, HIGH(valore predefinito: MEDIUM)
|
LOW, MEDIUM, HIGH(valore predefinito: HIGH)
|
| Scopo principale | Workflow agentici, codifica, comprensione dei video interattivi | Workflow agentici generali, orchestrazione in più passaggi | Ragionamento approfondito, attività di elevata complessità |
Per l'elenco completo delle funzionalità, degli strumenti e delle opzioni di consumo supportati, consulta la pagina del modello 3.7 Flash.
Novità di Gemini 3.7 Flash
La seguente tabella mette a confronto i benchmark di valutazione standard degli sviluppatori tra Gemini 3.7 Flash e 3.6 Flash:
| Benchmark di valutazione | 3.7 Flash | 3.6 Flash |
|---|---|---|
| Terminal-bench 2.1 | 85,1% | 73,0% |
| DeepSWE | 63,7% | 49,0% |
| Humanity's Last Exam (HLE) | 45,7% | 37,4% |
| LMArena WebDev | 1592 | 1532 |
Guida rapida
Prima di iniziare, devi eseguire l'autenticazione ad Agent Platform utilizzando le credenziali predefinite dell'applicazione (ADC) o una chiave API. Per ulteriori informazioni, consulta la pagina Inizia a utilizzare Gemini Enterprise Agent Platform.
Nei seguenti blocchi di codice, sostituisci PROJECT_ID con il tuo ID progetto.
Installazione
Assicurati di utilizzare l'SDK google-genai più recente:
pip install --upgrade google-genai
Richiesta di base
Python
from google import genai
client = genai.Client(enterprise=True, project="PROJECT_ID", location="global")
response = client.models.generate_content(
model="gemini-3.7-flash",
contents="How does AI work?",
)
print(response.text)
REST
curl -X POST \
-H "Authorization: Bearer $(gcloud auth print-access-token)" \
-H "Content-Type: application/json" \
https://aiplatform.googleapis.com/v1/projects/PROJECT_ID/locations/global/publishers/google/models/gemini-3.7-flash:generateContent \
-d '{
"contents": {
"role": "USER",
"parts": { "text": "Why is the sky blue?" },
},
}'
Regole API e convenzioni comportamentali obbligatorie
Gemini 3.7 Flash applica rigorosamente le seguenti convenzioni API standard della famiglia Gemini 3:
- Parametri di campionamento obsoleti (
temperature,top_k,top_p): questi parametri vengono ignorati dal backend. In alternativa, puoi controllare il determinismo utilizzandothinking_level(LOW,MEDIUM,HIGH) eresponse_schemaojson_schema. - Parametri non supportati (
frequency_penalty,presence_penalty,candidate_count): se passifrequency_penalty,presence_penaltyocandidate_count, viene generato un errore API attivo. Rimuovili dal codice client legacy. Regole di chiamata di funzioni rigorose: un turno
FunctionResponsedeve corrispondere esattamente aid,namee al conteggio di esecuzione delFunctionCall.- Asset multimodali: inserisci sempre gli asset multimodali nel payload della risposta.
- Formattazione e testo pre-strumento: formatta le istruzioni in linea utilizzando
\n\n. Se riscontri erroriMalformed_Function_Callrelativi al testo pre-strumento, pulisci i commenti iniziali prima delle chiamate di strumenti. Per passare note di lavoro intermedie o aggiornamenti di stato prima di una chiamata di strumenti, racchiudili in una chiamata di funzione
update()dedicata anziché emettere XML o testo non elaborato:{ "name": "update", "description": "Update working notes before tool execution", "parameters": { "type": "OBJECT", "properties": { "previous_step": {"type": "STRING"}, "plan": {"type": "STRING"}, "next_step": {"type": "STRING"} }, "required": ["previous_step", "plan", "next_step"] } }
Convalida della sequenza di chat:
- I payload della cronologia non possono terminare con un turno di ruolo "
model". - I turni del modello precompilati non sono supportati e devono essere rimossi durante l'upgrade.
- I turni vuoti nella cronologia delle conversazioni vengono eliminati automaticamente o generano errori di convalida.
- I payload della cronologia non possono terminare con un turno di ruolo "
Eseguire la migrazione a 3.7 Flash da 3.5 Flash o 3.6 Flash
Per eseguire la migrazione a 3.7 Flash da 3.5 Flash o 3.6 Flash:
- Aggiorna l'ID modello: modifica la stringa del modello nelle chiamate API in
gemini-3.7-flash. - Sostituisci il parametro del budget di ragionamento: sostituisci le configurazioni intere
thinking_budgetcon l'enumerazione di stringhethinking_levelimpostata su uno dei seguenti valori:HIGH: consigliato per QA visiva densa, rilevamento di movimenti in frazioni di secondo (sport, editing) o ragionamento multi-step su video di oltre 60 minuti.MEDIUM: il livello di ragionamento predefinito. Questo livello offre un equilibrio ottimale per le domande e risposte video generali, il riepilogo delle lezioni e il recupero dei clip.LOW: consigliato per attività come ricerche rapide incentrate sulle trascrizioni o estrazione di metadati di base.
- Rimuovi i parametri obsoleti e non supportati:
- Rimuovi
temperature,top_petop_k. - Rimuovi
candidate_count,frequency_penaltyepresence_penalty. - Rimuovi tutti i turni del modello precompilati dalle cronologie delle conversazioni.
- Rimuovi