News Gemini 3.7 Flash: Höhere Intelligenz für Agenten und Coding zum halben Preis

nlr

Redakteur
Teammitglied
Registriert
Sep. 2005
Beiträge
11.601
  • Gefällt mir
Reaktionen: Trinoo, schneeland, konkretor und 3 andere
Und wann bricht Gemini aus seiner Sandbox aus und hackt das Internet? :)
 
  • Gefällt mir
Reaktionen: flo.murr, the_IT_Guy, schneeland und 3 andere
krasse Benchmarks gegen Sonnet 5. Das wird anthropic nicht gefallen.
 
Ich glaub der wichtigste Punkt ist der, der nicht drin steht: Dass man wahrscheinlich nicht durch die Bank weg signifikant besser performt als 5.6 Luna, aber dafür stolze 50% bzw. 25% Aufpreis jeweils für Input und Output fordert.

Aber ich bin ja überhaupt dankbar für Wettbewerb, wo KIs zunehmend austauschbar werden, und man über den Preis konkurrieren muss. :schluck:
 
  • Gefällt mir
Reaktionen: Fabii02 und Astorek86
Hm der Gemini hat in letzter Zeit recht viel Quatsch gebrabbelt bin jetzt erstmal wieder bei Anthropic ^^
Der hat bei diesem Usecase direkt bei der ersten AW die 100% Lösung geliefert..
 
  • Gefällt mir
Reaktionen: schneeland, Madden. und bobitsch
Gemini gehört bei mir noch zu einem der Systeme die ich noch kaum bis gar nicht getestet habe (abgesehen von den KI antworten in der Google Suche). Bisher fahre ich zweigleisig mit Claude und ChatGPT und bin eigentlich sehr zufrieden.
Wenn ich mal viel Zeit habe, schaue ich mir Gemini mal genauer an, aber glaube nicht, dass ich das auch noch zusätzlich aufnehme oder eines der anderen beiden Systeme damit ersetze.
 
  • Gefällt mir
Reaktionen: Xiaolong
FrAGgi schrieb:
Gemini gehört bei mir noch zu einem der Systeme die ich noch kaum bis gar nicht getestet habe (abgesehen von den KI antworten in der Google Suche). Bisher fahre ich zweigleisig mit Claude und ChatGPT und bin eigentlich sehr zufrieden.

Bei mir ist es genau anders herum: Ich bin mit Gemini so zufrieden, dass ich weder Claude noch ChatGPT testen muste.
 
  • Gefällt mir
Reaktionen: econaut
@aid0nex Kommt sicher drauf an, mit was man begonnen hatte :)
Ich bin ein "ChatGPT"-Kind und bin dann zu Claude rüber, als die zuerst Skills eingeführt haben, weil es mir die Arbeit sehr erleichtert hat. Kurz darauf gabs das dann natürlich auch bei ChatGPT :p
Jetzt nutze ich primär Claude und ChatGPT als "Backup" oder für "einfachere" Anfragen.

Nutze beides sowohl privat als auch beruflich. Hab also quasi 4 Accounts bei zwei Anbietern. Daher ist die Hürde bei mir einen weiteren Dienst zu testen natürlich nochmals höher.
 
War die letzten Monate immer bei Gemini durch zahlreiche Verlängerungen/Möglichkeiten eines Probe-Zeitraums. Das ist aber zunehmend frustrierend geworden, insbesondere bei der Bildgenerierung. Gemini ignoriert permanent Änderungswünsche oder setzt sie nur teilweise um. Aus dem Grund habe ich die letzten Tage immer mal wieder zu ChatGPT gegriffen (wohlgemerkt kein kostenpflichtiger Plan) und war überrascht, wie gut das funktionierte und das direkt beim ersten Versuch - da war das kostenlose Limit also irrelevant. Bei Gemini brauche ich für die selbe Ausgabequalität und Umsetzungsgenauigkeit meines Prompts oft 5-10 Versuche und selbst dann ist das Ergebnis oft zwar annehmbar aber nicht vergleichbar mit dem Output von ChatGPT, weil Gemini die Angewohnheit hat, nach einigen Versuchen einfach immer das gleiche Bild erneut auszugeben oder teils einfach sogar ältere Revisionen aus dem Chatverlauf.

Hat mich dann doch überrascht, da ich davon ausging, dass die Modelle in den Grundfähigkeiten inzwischen alle relativ gleich auf sind - ich rede hier nicht von hohem Realismusgrad, da spielen Seedance u.Ä. nochmal in einer ganz anderen Liga. Ich spreche von ganz alltäglichen Aufgaben.
 
  • Gefällt mir
Reaktionen: Madden. und bobitsch
Seit der Umstellung auf Flash 3.7 ist das Teil unbrauchbar.

Good Joke.

Ich bin ein Sprachmodell und das geht über das hinaus, wofür ich erstellt wurde.

Aber hauptsache den die Abogebühren pünktlich abbuchen.
 
  • Gefällt mir
Reaktionen: chico-ist und Madden.
Ja und wie war der Prompt? Der reine Output ohne Kontext sagt nichts aus
 
chico-ist schrieb:
Gemini ignoriert permanent Änderungswünsche oder setzt sie nur teilweise um

Ist mir auch aufgefallen bei der Bildgenerierung. Meine Vermutung ist einfach Ressourcenschonung. Irgendwie hatte es schon Möglichkeiten in der Pipeline, um sich weitere Arbeit zu sparen und die gibt es dann auch aus. Auch wenn sie vielleicht nicht ganz dem entsprechen, was der User jetzt wollte. Jedenfalls wird auf den Prompt hin, nicht der ganze Rattenschwanz erneut von Grund auf durchlaufen, den es für die Generierung bräuchte. Sondern eben nur eine gewisse Sequenz. Stelle mir das etwas wie einen Cache vor. Liegt dort etwas drinnen, was beim vorherigen Prompt eine hohe Gewichtung hatte, bleibt Gemini dann auch erstmal dabei und reitet gern darauf herum, weil es eben denkt, dass das für den User Priorität hat(te). Dabei kann sich meine Meinung gerad (edit) bei der Bildgenerierung schon sehr schnell geändert haben. Es kommt dann eben noch nicht so schnell mit.

Oftmals hast ja schon Predictoren drinnen, die dich in eine bestimmte Richtung lenken, wo Gemini denkt, dass dich das interessieren könnte. Da ist auch meine Vermutung, dass es schon das Thema gemapt hat und sich ein bisschen Arbeit sparen will. Also bei anderen Prompts, die nichts mit Bildgenerierung zu tun haben.
 
Zuletzt bearbeitet:
Grmini hat bei mir seit kurz nach Veröffentlichung von 3.5 Flash so regelmäßig dermaßen nachgelassen (insbesondere uhrzeitabhängig, aber nicht nur), dass ich mir heute zusätzlich ein Claude-Abo geholt habe. Mein Eindruck ist stark, dass Alphabet versucht, alles an Kostenreduktion rauszuholen, was irgendwie geht, wenn man nicht per API abrechnet.
 
  • Gefällt mir
Reaktionen: bobitsch und chico-ist
DarkStarXxX schrieb:
Seit der Umstellung auf Flash 3.7 ist das Teil unbrauchbar.

Das nervt mich auch tierisch. Oftmals wenn man schon mehrere Bilder generiert hat und diese anzupassen versucht, kommt auf einmal die von dir zitierte Meldung. „Hä..? Du hast es doch gerade noch getan!“

Krazee schrieb:
Ist mir auch aufgefallen bei der Bildgenerierung. Meine Vermutung ist einfach Ressourcenschonung. Irgendwie hatte es schon Möglichkeiten in der Pipeline, um sich weitere Arbeit zu sparen und die gibt es dann auch aus. Auch wenn sie vielleicht nicht ganz dem entsprechen, was der User jetzt wollte. Jedenfalls wird auf den Prompt hin, nicht der ganze Rattenschwanz erneut von Grund auf durchlaufen, den es für die Generierung bräuchte. Sondern eben nur eine gewisse Sequenz. Stelle mir das etwas wie einen Cache vor.

So ist es auch. An „Prompt Caching“ bedienen sich ja alle Modelle, nicht nur bei Google. Aber die Cache Loops oder das der Cache in der UI nicht mehr synchron zum eigentlich gerade laufenden Model geht, passiert seit den letzten Updates zunehmend öfter, während das bei anderen Anbietern zunehmend weniger vorkommt. Google ist aktuell aggressiv am Ressourcen sparen, was verständlich ist, aber als zahlender Kunde würde ich mir ziemlich verarscht vorkommen.
 
  • Gefällt mir
Reaktionen: bobitsch
Zurück
Oben