Was Google tatsächlich angekündigt hat
Google beschreibt Gemini 3.6 Flash als Workhorse-Modell mit stärkerer Coding-Leistung, besserer Wissensarbeit und multimodaler Performance. Der Release-Artikel berichtet von 17 % weniger Ausgabetokens als 3.5 Flash im Artificial Analysis Index, einem niedrigeren Preis von 1,50 USD pro Million Eingabetokens und 7,50 USD pro Million Ausgabetokens sowie weniger Denkschritten und Toolaufrufen bei mehrstufiger Arbeit. Dies sind herstellerseitige allgemeine Ergebnisse; sie sind keine Unreal-Benchmarks.
In derselben Ankündigung werden DeepSWE mit 49 % gegenüber 37 % für 3.5 Flash, MLE Bench mit 63,9 % gegenüber 49,7 % und OSWorld-Verified mit 83,0 % gegenüber 78,4 % berichtet. Ein Unreal-Team kann diese Hinweise nutzen, um Code-Änderungen, Repository-Navigation, visuelle Belege und werkzeuggestützte Workflows zu testen. Das Team sollte dennoch seinen eigenen Aufgabenbestand, die Engine-Version, die Hardware, das erwartete Ergebnis und Belege für Fehler veröffentlichen.
Ein nutzbares Gemini-zu-Unreal-Betriebsmodell
Halten Sie das Modell außerhalb der Verantwortungsgrenze des ausgelieferten Spiels. Gemini kann einen Diff vorschlagen, einen Crash-Trace erklären, Screenshots klassifizieren oder einen Testplan entwerfen. Das Unreal-Repository, Build-System, Editor, automatisierte Tests, Profiler, paketierte Build-Version und menschliche Freigabe entscheiden darüber, ob der Vorschlag akzeptiert wird.
Beginne mit dem kleinsten reproduzierbaren Kontext. Gib die Unreal-Version, Modul- oder Blueprint-Namen, Zielplattform, relevante Quelle, exakten Fehler oder Screenshot, erwartetes Verhalten und Abnahmetests an. Schließe Geheimnisse, nicht verwandte Projektdateien, private Assets und Benutzerdaten aus. Bitte um Annahmen und Unsicherheiten getrennt von vorgeschlagenen Änderungen, damit Prüfer eine nicht belegte Annahme verwerfen können, ohne eine nützliche Analyse abzulehnen.
Bewertungs-Scorecard für ein reales Projekt
- Erkennt das zuständige Unreal-Subsystem korrekt, bevor eine Änderung vorgeschlagen wird.
- Berührt nur Dateien und Blueprint-Verantwortlichkeiten, die durch die Aufgaben-Grenze erlaubt sind.
- Erstellt eine nachvollziehbare Erklärung, einen Diff-Plan, eine Testliste und einen Rollback-Punkt.
- Besteht Prüfung von Kompilierung, Editor-Checks, Automatisierung, Smoke-Tests für die Paketierung und Plattformziele.
- Gibt keine Geheimnisse preis, erfindet keine APIs, fälscht keine Testerfolge und vermischt keine Browser-Ausgabe mit einem nativen Unreal-Artefakt.
- Verbessert die gemessene Durchführungszeit oder die Review-Qualität ausreichend, um Modell- und Human-Review-Kosten zu rechtfertigen.