Du verwendest einen veralteten Browser. Es ist möglich, dass diese oder andere Websites nicht korrekt angezeigt werden. Du solltest ein Upgrade durchführen oder einen alternativen Browser verwenden.
NewsGemini 3.7 Flash: Höhere Intelligenz für Agenten und Coding zum halben Preis
Google hat das neue KI-Modell Gemini 3.7 Flash vorgestellt. Die jüngste Iteration der Flash-Serie bietet Leistungssteigerungen bei der Softwareentwicklung, der automatisierten Wissensarbeit sowie bei komplexen agentenbasierten Abläufen. Die Veröffentlichung kommt nur drei Wochen nach dem Release von Gemini 3.6 Flash.
Ich glaub der wichtigste Punkt ist der, der nicht drin steht: Dass man wahrscheinlich nicht durch die Bank weg signifikant besser performt als 5.6 Luna, aber dafür stolze 50% bzw. 25% Aufpreis jeweils für Input und Output fordert.
Aber ich bin ja überhaupt dankbar für Wettbewerb, wo KIs zunehmend austauschbar werden, und man über den Preis konkurrieren muss.
Hm der Gemini hat in letzter Zeit recht viel Quatsch gebrabbelt bin jetzt erstmal wieder bei Anthropic ^^
Der hat bei diesem Usecase direkt bei der ersten AW die 100% Lösung geliefert..
Gemini gehört bei mir noch zu einem der Systeme die ich noch kaum bis gar nicht getestet habe (abgesehen von den KI antworten in der Google Suche). Bisher fahre ich zweigleisig mit Claude und ChatGPT und bin eigentlich sehr zufrieden.
Wenn ich mal viel Zeit habe, schaue ich mir Gemini mal genauer an, aber glaube nicht, dass ich das auch noch zusätzlich aufnehme oder eines der anderen beiden Systeme damit ersetze.
Gemini gehört bei mir noch zu einem der Systeme die ich noch kaum bis gar nicht getestet habe (abgesehen von den KI antworten in der Google Suche). Bisher fahre ich zweigleisig mit Claude und ChatGPT und bin eigentlich sehr zufrieden.
@aid0nex Kommt sicher drauf an, mit was man begonnen hatte
Ich bin ein "ChatGPT"-Kind und bin dann zu Claude rüber, als die zuerst Skills eingeführt haben, weil es mir die Arbeit sehr erleichtert hat. Kurz darauf gabs das dann natürlich auch bei ChatGPT
Jetzt nutze ich primär Claude und ChatGPT als "Backup" oder für "einfachere" Anfragen.
Nutze beides sowohl privat als auch beruflich. Hab also quasi 4 Accounts bei zwei Anbietern. Daher ist die Hürde bei mir einen weiteren Dienst zu testen natürlich nochmals höher.
War die letzten Monate immer bei Gemini durch zahlreiche Verlängerungen/Möglichkeiten eines Probe-Zeitraums. Das ist aber zunehmend frustrierend geworden, insbesondere bei der Bildgenerierung. Gemini ignoriert permanent Änderungswünsche oder setzt sie nur teilweise um. Aus dem Grund habe ich die letzten Tage immer mal wieder zu ChatGPT gegriffen (wohlgemerkt kein kostenpflichtiger Plan) und war überrascht, wie gut das funktionierte und das direkt beim ersten Versuch - da war das kostenlose Limit also irrelevant. Bei Gemini brauche ich für die selbe Ausgabequalität und Umsetzungsgenauigkeit meines Prompts oft 5-10 Versuche und selbst dann ist das Ergebnis oft zwar annehmbar aber nicht vergleichbar mit dem Output von ChatGPT, weil Gemini die Angewohnheit hat, nach einigen Versuchen einfach immer das gleiche Bild erneut auszugeben oder teils einfach sogar ältere Revisionen aus dem Chatverlauf.
Hat mich dann doch überrascht, da ich davon ausging, dass die Modelle in den Grundfähigkeiten inzwischen alle relativ gleich auf sind - ich rede hier nicht von hohem Realismusgrad, da spielen Seedance u.Ä. nochmal in einer ganz anderen Liga. Ich spreche von ganz alltäglichen Aufgaben.
Ist mir auch aufgefallen bei der Bildgenerierung. Meine Vermutung ist einfach Ressourcenschonung. Irgendwie hatte es schon Möglichkeiten in der Pipeline, um sich weitere Arbeit zu sparen und die gibt es dann auch aus. Auch wenn sie vielleicht nicht ganz dem entsprechen, was der User jetzt wollte. Jedenfalls wird auf den Prompt hin, nicht der ganze Rattenschwanz erneut von Grund auf durchlaufen, den es für die Generierung bräuchte. Sondern eben nur eine gewisse Sequenz. Stelle mir das etwas wie einen Cache vor. Liegt dort etwas drinnen, was beim vorherigen Prompt eine hohe Gewichtung hatte, bleibt Gemini dann auch erstmal dabei und reitet gern darauf herum, weil es eben denkt, dass das für den User Priorität hat(te). Dabei kann sich meine Meinung gerad (edit) bei der Bildgenerierung schon sehr schnell geändert haben. Es kommt dann eben noch nicht so schnell mit.
Oftmals hast ja schon Predictoren drinnen, die dich in eine bestimmte Richtung lenken, wo Gemini denkt, dass dich das interessieren könnte. Da ist auch meine Vermutung, dass es schon das Thema gemapt hat und sich ein bisschen Arbeit sparen will. Also bei anderen Prompts, die nichts mit Bildgenerierung zu tun haben.
Grmini hat bei mir seit kurz nach Veröffentlichung von 3.5 Flash so regelmäßig dermaßen nachgelassen (insbesondere uhrzeitabhängig, aber nicht nur), dass ich mir heute zusätzlich ein Claude-Abo geholt habe. Mein Eindruck ist stark, dass Alphabet versucht, alles an Kostenreduktion rauszuholen, was irgendwie geht, wenn man nicht per API abrechnet.
Das nervt mich auch tierisch. Oftmals wenn man schon mehrere Bilder generiert hat und diese anzupassen versucht, kommt auf einmal die von dir zitierte Meldung. „Hä..? Du hast es doch gerade noch getan!“
Krazee schrieb:
Ist mir auch aufgefallen bei der Bildgenerierung. Meine Vermutung ist einfach Ressourcenschonung. Irgendwie hatte es schon Möglichkeiten in der Pipeline, um sich weitere Arbeit zu sparen und die gibt es dann auch aus. Auch wenn sie vielleicht nicht ganz dem entsprechen, was der User jetzt wollte. Jedenfalls wird auf den Prompt hin, nicht der ganze Rattenschwanz erneut von Grund auf durchlaufen, den es für die Generierung bräuchte. Sondern eben nur eine gewisse Sequenz. Stelle mir das etwas wie einen Cache vor.
So ist es auch. An „Prompt Caching“ bedienen sich ja alle Modelle, nicht nur bei Google. Aber die Cache Loops oder das der Cache in der UI nicht mehr synchron zum eigentlich gerade laufenden Model geht, passiert seit den letzten Updates zunehmend öfter, während das bei anderen Anbietern zunehmend weniger vorkommt. Google ist aktuell aggressiv am Ressourcen sparen, was verständlich ist, aber als zahlender Kunde würde ich mir ziemlich verarscht vorkommen.