Drei Wochen. Das ist die Lücke zwischen Gemini 3.6 Flash und Google Gemini 3.7 Flash, einem gehosteten LLM, das gezielt auf Coding-Agenten und dokumentenintensive Wissensarbeit ausgerichtet ist. Kein neuer Pre-Training-Durchlauf – Google sagt, die Verbesserungen resultieren aus algorithmischer Arbeit an der Kern-Reasoning-Schicht.
Die Zahlen belegen das. FrontierCode 1.1 Main springt von 34,4 % auf 43,6 %. WebDev Arena Elo steigt von 1538 → 1588, was bedeutet, dass weniger Prompts nötig sind, um aus einem Screenshot ein funktionierendes Layout zu erhalten. Gemini Spark ist am ersten Tag darauf umgestiegen. HN platzierte es mit 480 Punkten auf der Titelseite.
Was Sie über die API erhalten
Jetzt verfügbar über die Gemini API und Vertex AI: 1 M-Token-Kontext, bis zu 64 K-Ausgabe, Text/Bild/Audio/Video-Eingabe und ein konfigurierbares Denk-Level, mit dem Sie das Reasoning für günstige Bulk-Aufrufe herunterdrehen und für anspruchsvolle Agent-Schleifen hochdrehen können. Der Einführungspreis beträgt $0.75 pro 1 M Eingaben und $3.75 pro 1 M Ausgaben – genau die Hälfte von 3.6 Flash – bis zum 1. Januar 2027, wenn er wieder auf $1.5/$7.5 steigt.
Der unbequeme Teil
Google hat inzwischen zwei Flash-Generationen veröffentlicht, während Gemini 3.5 Pro weiterhin verzögert bleibt. Das Arbeitspferd wird immer schneller und günstiger; das Flaggschiff ist nach wie vor nicht verfügbar.