News Speicher zu teuer: RTX-5000-Super-Refresh erneut von Nvidia gestoppt?

Syrato schrieb:
Wie kann Speicher zu teuer sein?
Kann man doch an die Kunden weiter geben. 3600€ für eine 5090 ist sehr akkurat!
Wo gibt es die so "günstig"?
Ergänzung ()

SweetOhm schrieb:
Weshalb denn ?!?
Die sollen doch einfach je GB 100 € verlangen, wird doch trotzdem gekauft !! :cheerlead:
Machen sie ja schon. 3200€ für den Speicher der 5090, 800€ für die GPU.
 
Sebbi schrieb:
weil man ersteinmal die veralteten 3000er Bestände versilbern will.
Wie kommst du auf die wirre Idee dass Jensen noch hunderttausende RTX30 Chips im Lager verstauben hat, 4 (!) Jahre nachdem sie von der RTX40 Serie abgelöst wurde. Gäbs seit 1-1,5 Jahren den AI Hype nicht wäre das alles ein Fall für die Mülltonne. Das ist betriebswirtschaftlicher grober Unfug, das macht so niemand.
Ausser ein paar Restbeständen und Kleinmengen die man für etwaige RMA Ansprüche zurück behalten hat fällt das genau so wie der 5800X3D frisch vom Band bei TSMC. Bei älteren Fertigungsnodes ists auch leichter an Waferzahlen zu kommen.
 
Zuletzt bearbeitet:
  • Gefällt mir
Reaktionen: vti, RaptorTP und Sirhaubinger
aha, also TSMC, die sagen das die auf Jahre ausgelastet wären, soll also nicht die Linien für die RTX30 Chips in der Zwischenzeit umgerüstet haben, so damit wie weiterhin die RTX30 Chips, die wie du schon sagstest, vor 4 Jahren abgelöst wurden, weiterhin produzieren können und nicht andere Dinge, die aktueller sind etc ?

btw vor 4 Jahren wurde der 5800X3D erst released und wurde 2024, also vor 2 Jahren dann eingestellt. Da dürfte aber AMD schon an dem 10 Jahre Jubileum gearbeitet haben, so das die Linien gar nicht erst umgerüstet wurden sondern der Prozessoer einfach dann für das 10 Jahre Jubileum produziert wurde.
 
superrocko schrieb:
Kann man nun auch gleich den Refresh überspringen, und gleich die Next Gen Karten bringen nächstes Jahr ;)
Kommen erst 2028 vermutlich zumindest vielleicht noch spät in 2027, aber ja wahrscheinlich wird man mindestens 6 Monate gegen AMD nur Refresh aufbringen können und vielleicht können sie mit "DLSS" 5 noch die Leute vom Umstieg dann abhalten. Nach dem Motto das ist "next gen" und da AMD das nicht hat sind sie quasi unbenutzbare Grafikkarten überspitzt gesagt das wird der Pitch sein und der Versuch ein totales Monopol zu errichten.

Nvidia ist nicht im Zugzwang selbst wenn sich die RTX5000 Karten schlecht wegen den Wucherpreisen verkaufen sollten (was sie glaub nicht wirklich tun) viele Leute zahlen gern 100% Aufpreis für 20% mehr Speed, aber selbst wenn sich das irgendwie durch setzten würde und die Leute Rational im Moment wegen massiv besserer Preisleistung auf AMD setzen würden und vielleicht sogar noch Mediamarkt und Co alle ihre PCs oder die meisten auf AMD umstellen würden, macht Nvidia das Geld über K.I. ich mein man gibt ja die nächste Gen komplett auf, man tritt dann mit der jetzigen Gen gegen die nächste von AMD an und wenn RTX 6000 kommt könnte schon fast die übernächste Gen von AMD sich abzeichnen.

Also Nvidia ist der Marktanteil bei Grafikkarten fast egal, mein jede verkaufte spielerkarte mit 100% Marge ist im Zweifel 1 K.I. Karte mit 400% Marge weniger.
 
  • Gefällt mir
Reaktionen: NHEADY55, JarlBallin und phanter
Chismon schrieb:
...so dasss eigentlich nur die RTX 5060 "Super" (mit 12 GB anstelle 8 GB) und RTX 5070 "Super" (mit 18 GB anstelle 12 GB) als Refreshs interessant wären).

Die 3GB-Chips sind drei- bis dreieinhalbmal so teuer wie ein 2-GB-Chip, so dass 12 GB VRAM absurder Weise teurer sind, als 16 GB. Das heißt für Nvidia wäre es sogar billiger die RTX 5060 mit 16GB auszustatten, als mit 12GB. D.h. bei gleichem Verkaufspreis hätte Nvidia bei 16GB eine höhere Marge als bei 12 GB. Das Gleiche bei der RTX 5070. Die RTX 5070 mit 18 GB würde Nvidia mehr kosten als die RTX 5070 mit 24GB. Daher ist es auch nachvollziehbar, dass Nvidia dann dem Speicherhersteller sagt, entweder senkst du deine Preise für 3GB-Chips, oder ich bleibe bei den 2GB-Chips...
 
  • Gefällt mir
Reaktionen: Chismon
Ist gar nicht mal so abwegig, dass überhaupt gar keine neuen Karten mehr kommen.
Aktuell macht es doch aus betriebswirtschaftlicher Sicht 0,0 Sinn, irgendwas an die paar Endkunden zu verkaufen, wenn man die Kapazitäten genauso gut für den x-fachen Preis an KI-Innovatoren verkaufen kann.

Erste Handhelds komplett ohne GPU, die rein als Streaming-Device dienen gibts ja jetzt auch schon. Und es gibt mehr und mehr Anbieter und Angebote zum Streamen von Spielen.

Man sollte einfach mal mit gar nichts rechnen, dann kann man nicht enttäuscht werden.
 
  • Gefällt mir
Reaktionen: iron_monkey
Die sollen einfach die 6000er mit der 5000er VRam Bestückung bringen und gut ist.
 
Syrato schrieb:
@Alphanerd in der Schweiz, CHF 3400, Gainward.
Google sagt mir

3400 × 1,08296 = 3682,06 EUR (sind ja eher 3,7 als 3,6k)

Also hier fangen die knapp unter 4k an.
 
Warum kann Jensen nicht mal fair zu seinen Gamern sein? Einfach mal den Speicher zum Einkaufspreis auf die Karten löten. Den würde ich gerne mal treffen. Der könnte sich was anhören...
Ergänzung ()

superrocko schrieb:
Kann man nun auch gleich den Refresh überspringen, und gleich die Next Gen Karten bringen nächstes Jahr ;)
Mal sehen, ob überhaupt was kommt..
 
Sebbi schrieb:
aha, also TSMC, die sagen das die auf Jahre ausgelastet wären, soll also nicht die Linien für die RTX30 Chips in der Zwischenzeit umgerüstet haben,
Nur weil man einen Teil der Produktionsstraßen auf neue Nodes umstellt oder gar neue Hallen baut heisst das nicht dass ältere Nodes nicht trotzdem weiterlaufen für andere Produkte die Stückzahlen und die kleinste Fertigungsgröße nicht brauchen.
Wenn die neue Generation ansteht wird die alte sukzessive vorher schon runtergefahren und abverkauft.
Dass Stückzahlen über bleiben, geschenkt, aber nicht in der Menge um ein Produkt Jahre später erneut in den Markt zu bringen.
Hunderttausende Chips zu produzieren und zu horten und Lagerkosten zu erzeugen in der Hoffnung die in einem halben Jahrzehnt vielleicht durch Zufall wieder zu verhökern ist geschäftlicher Nonsens !
Man möchte meinen, dass Leute hier zu selbständigem Denken fähig wären, aber so kann man sich manchmal täuschen....
Ich wart ja nur noch auf die Kandidaten die Naturereignisse im klimatisch/geologisch instabilen Südostasien wieder mit Schweinezyklus betiteln.
Klar, die dortigen Firmen verursachen Erdbeben & Co natürlich selbst, um Produktionsausfall und Instandsetzungskosten zu verursacgen.
Vermutlich nutzen die das selbe HARP Array, das die Demokraten in USA genutzt haben, um es mit Geoengineering an Trump´s Geburtstagsparty regnen lassen haben.
😂
 
Zuletzt bearbeitet:
  • Gefällt mir
Reaktionen: minalion und Optimal Setting
Dann sollen die Partnerkartenhersteller (Asus, MSI und Co) was tun für ihre völlig überteuerten Karten, sollen die ihre Bretter anpassen sodass mehr 2GB Chips darauf passen.
Ist ja nicht so als könne man die PCBs nicht etwas vergrößern, die sind doch sowieso zu klein für die riesigen Kühler...
 
@Wolfgang.R-357:
Es liegt nicht an den Partnerherstellern. Es liegt an den Vorgaben von Nvidia. Die RTX 5060 TI gibt es ja mit doppelter Bestückung. Die anderen Karten dürfen nicht mit mehr Speicher bestückt werden. Nvidia verkauft die GPU mit VRAM im Bundel, da darf kein Hersteller noch VRAM dazu packen...
Ergänzung ()

jauns91 schrieb:
...ist ja klar dass Nvidia die 2GB chips munter weiterlaufen lässt weil die 3 GB Chips stehen ja wahrscheinlich direkt im Konkurrenz mit den KI Profikarten. Und da ist die Marge nochmal eine ganz andere.
Im mobilen Segment werden die 3GB-chips von Nvidia auch verkauft, weil man dort mit 3GB-Chips einfach mehr Speicher bieten kann ohne das Clamshell-Verfahren nutzen zu müssen.

https://www.computerbase.de/news/gr...12-gb-gddr7-jetzt-offiziell-bestaetigt.97105/

https://www.computerbase.de/news/gr...070-ti-im-notebook-mit-24-16-und-12-gb.90890/
 
Zuletzt bearbeitet:
Alphanerd schrieb:
Google sagt mir

3400 × 1,08296 = 3682,06 EUR (sind ja eher 3,7 als 3,6k)

Also hier fangen die knapp unter 4k an.
MWST. auch angepasst? 😋 Du Pünktlischisser
 
  • Gefällt mir
Reaktionen: Alphanerd
Das letzte mal als ich die preise für 24gbit gd7 gesucht habe waren diese bei 25-30$ wenn das auf 30-35$ gestiegen sind sagt das deutlich aus das dass Kartell hier wirkt.
Die einzige sku die diese module nutzt ist die rtx6000 pro ne gpu ab 13000€
Und die Kapazität ist begrenzt da viele dram Produzenten sich auf hbm fokussieren was 4 fache wafer benötigt.
Und fabs sind begrenzt hier merkt man die Speku Blase von ai.
Ein hoher bedarf an rtx6000 pro wird es kaum geben nicht bei dem preis.
Daher gehe ich davon aus das die meisten chips an die teuerste sku gehen und nvidia quasi den markt bestimmt damit diese an sich verkauft. Da ist kein stück Hardware über die Theke gelaufen.
Den preis Zahlen die aib und geben das 1-1 an den Kunden zurück
Bei 16gbit chips sieht es nicht besser aus das letzte mal lag dieser bei 10$ ähnlich zu mining Zeiten mit gddr6x.
Das erklärt die preise gddr6 steigt aktuell auch bei grob 9$ per 16gbit und da nvidia von chip vram bundle weggegangen ist nehmen die aib gerade ein größere marge für ihre gpu 30% statt 20%
Die ganze Preiskrise lässt sich auf die ai Blase und einen Kartell zurückführen.
Ein weiteres absagen von rtx50 super würde bedeuten das nvidia schon 2027 sich vom desktop zurückzieht

Ein refresh der Serie wäre ratsam mit angepassten pcb und größeren Speicher ideal in echten n4x node -22% Energie.
Software zurück auf ada level aufgeben von fg und ein zurück von cuda 32bit
Machbar ist das nur nvidia will server verkaufen am besten ganze fabs.
Der ceo lebt in einer Fantasiewelt weil er Verkäufer ist und kein Ingenieur weder Elektrik noch software
Den wenn er das wüsste wäre klar das AI ne Hilfe im besten fall ist und keine selbstständige Individuum ist.
nvidia lebt von ihrer guten idee aus dem Jahr 2006
ja 20 Jahre ist das design alt in software hat sich viel getan. Der kern bleibt aber ein auf 32bit mit 64bit Erweiterung laufende Architektur.
Für 64bit sind die sfu zuständig der rest läuft parallel in 32bit dabei spielt das Parallele ne wichtige rolle und erklärt auch wieso nvidia so große cpu lasten erzeugt.
Die alu sind so dumm das diese echte 16bit register haben die durch den trick bis 64bit rechnen können
Darum gibt es die 4gb grenze auch nicht
man ist soweit gekommen das satte 24576 alu bauen kann wovon real in fp32 15360 alu rechnen können in hardware und nochmal + 6144 alu in fp32 dazu mit glück abhängig wie stark die gpu int32 braucht. also faktisch dann von 74tf bis 84tf anhand von 170sm
Diese können kaum von der cpu bedient werden und das limit stellt zu 90% immer das PT dar
nvidai hilft gerade auch ein software update das mit blackwell gekommen ist die amp Einheit die in gpu scaling die gpu besser auslastet ein beta windows 10/11 feature wohlgemerkt.
Das kann funktionieren wird aber oft in software auf hard limit zurückgesetzt und dann gelten die bisherigen ada ampere limits von 88fp32 per sm in dx11 dx12 das ist die optimistische Annahme ich gehe sogar davon aus das blackwell auf die hardware fp32 zurückfällt was dann 80fp32 per sm sind.
Um das zu beweisen müsste ich selbst ne rtx5070 haben eher rtx5070 super den 18gb wären sinnig nur die tbp stößt sauer auf.
50sm mit nur 220w und voltage limit von 1,1v wären gut schlappe 10% schneller als meine rtx4070
Das ding würde ich zerreißen.
Der ganze software Fokus ist das problem der Serie und alle machen da Freiwillig mit.
ampere ada lovelace und blackwell haben den gleichen Kern nur ab ada ein viel zu dicken L2 cache der seit n16 nicht kleiner werden kann.
Blackwell mit ampere L2 cache Größe was bei gb305 dann 6mb wären in n3 wären die chips sogar billiger als derzeit.
Statt den 263mm² dank 3gpc 48mb wären es 165mm² und in n3 sogar nur 155mm²
man könnte die alu sogar auf 4gpc erweitern und damit maxed 66sm nutzen
der chip wäre 166mm² groß

Gpu sind lineare in order Prozessoren, post Prozess macht nur bedingt sinn und großer cache bewirkt nur mehr daten vorladen die aber kaum gebraucht werden da die Latenz zwischen vram und chip echt klein sind es sind grob 1ns da wird man von internen sram Takt begrenzt da bringt also mehr Bandbreite im chip nix
Das lässt sich nur in post Prozess nutzen wenn Programme out of order nutzen wofür gpu an sich nicht dafür designt wurden.
Selbst das dlss ist mehr schein als sein. Es ist ein algo der fixe Farbwerte manipuliert und somit rop last reduziert.
Der cache liegt brach das erklärt auch wieso dlss auf turing ampere ada und blackwell gleich gut laufen.
Den gpu's fehlt vram und mehr alu neben einer höheren ipc von den cpu das war jensen auch klar 2020 als mit ga100 bei 26,5tf kaum eine cpu diese auslasten konnte.
Das geht heute dank x3d und 5,2ghz und den Einsatz von software pathtraycing. Den mit hardware pathtraycing ist es mehr Kompromiss als viele denken.
Dxr ist der Kompromiss der viel cpu last erzeugt dieser misch Masch den es seit 2022 gibt verdanken wir einer Verschleierung von nvidia.
Die designs sind für data center entworfen worden wo man post process nutzen kann an gaming bringen viel cache der teuer ist nix.

Die cpu haben ordentlich aufgeholt mit zen6 erreicht man die magischen 6,7ghz singlecore Takt 6,5ghz mit glück multicore was bei games immer maximal 6 threads sind.
Intel ist unklar wie nova lake wird der mix aus e p und standby cores wird ein Desaster für den win sheduler

Dies wird die ersten cpu die eine rtx5090 immer bei 100% load bringt und das pt zum problem wird und nicht nur in 3dmark
Der abstand zur rtx4090 wird hart gekürzt auf nur noch +2%-10% da die rtx5090 statt den angezeigten 2,7ghz nur 2,0ghz packt.
128sm lassen sich eher beim Takt halten mit 500w tbp als 170sm bei 600w tbp

Das ist kein limit der nodes sondern ein design limit was auf maximal profit ausgelegt wurde.

hätte samsung zeitlich ihren sf4 node 2022 hinbekommen wäre ada sogar auf diesen gekommen dieser wäre nur bei 1,9ghz geblieben aber weil die wafer deutlich billiger sind nur 10000$ statt den damals 17000$ von tsmc wäre man mit mehr alu also 24sm per gpc dann in hardware faktisch schneller geworden nur der verbrauch wäre echt mies gewesen ein gb203 mit 6 gpc 120sm statt 6gpc 80sm 350w
sf3 hätte dann erst den sprung gebracht auf 2,5ghz
Anmerken muss ich das samsung heute (2025) erst sf4 ans laufen bekommen hat sf3 sich verspätet ist und sf2 fraglich bleibt.
Mit tsmc ist man auf level von n6 mit sf4 darum ist samsung keine option mehr.
intel ist unklar wie gut 18a ist nvidia geht das Risiko mit 14a ein mit feynman. mal sehen wie das wird.
ich kann nvidia nur raten auf a14 zu gehen 2032 den bis dahin wird es keine dgpu mehr geben wenn es blöd läuft.
Das liegt weniger an den node als am design das fehlt.
 
Fujiyama schrieb:
Ist vermutlich verzichtbar, nen besonderen Mehrwert war ja bisher mit den Supermodellen nicht vrohanden. Es ist quasi ein Facelift.
Für mich war der Facelift bei der RTX 4070 TI Super schon kaufentscheidend. Benötigte die 16GB für MSFS 2020 VR, musste aber keine 4080 kaufen...
 
  • Gefällt mir
Reaktionen: NHEADY55 und JarlBallin
Convert schrieb:
Das heißt für Nvidia wäre es sogar billiger die RTX 5060 mit 16GB auszustatten, als mit 12GB
Das wird wegen der 4 freien Speichermodulplätze bzw. dem Platinenlayout leider nicht gehen, aber klar, man könnte billiger und mehr Speicher mit 2 GB Modulen hinbekommen, wenn das Layout es vorsehen/ermöglichen würde und wenn der Platz vorhanden wäre (bspw. per Clamshell-Design). Jedoch kämen noch BIOS Modifikationen, usw. dazu, also viel zu viel kostentreibender Aufwand für eine Mittelklasse-Grafikkarte.
Ergänzung ()

lubi7 schrieb:
einfach die 6000er mit der 5000er VRam Bestückung bringen und gut ist.
Das fände ich auch okay, nur wird das vermutlich nicht für DLSS5 (bei entsprechender dGPU-Leistung) langen und gerade dafür sollte der RTX 5000er "Super" Refresh wohl primär kommen, zumal das vor Ende des Jahres dann idealer Weise hätte halbwegs rundlaufen können ab Karten mit mindestens 12 GB oder besser 16 GB Speicher und dann würden die 24 GB Speicherausbau wohl auch vereinzelt (in Vorzeigespielen) Sinn machen können, nehme ich an.
 
Zuletzt bearbeitet:
rentex schrieb:
Oh, wie doof. Wenn das eigene Handeln, die eigenen Produkte verteuert.
Da es ebenfalls die ganzen AI Beschleuniger verteuert, die nVidia in Massen absetzt, wird das die Grünen wohl nicht weiter stören.
Die Gamer sind für die doch eh nur noch lästiges Beiwerk.
 
  • Gefällt mir
Reaktionen: Alphanerd und rentex
theGucky schrieb:
Wundert mich nicht, das es Gerüchte einer 5080Ti mit einem beschnittenen GB202 mit 12x2GB gibt...

Sehe ich nicht..... warum sollten die das machen wen man daraus eine 6000er oder 5000er bauen kann? Weil nicht genug Speicher da ist? Dann klebe ich die doch nicht auf wenige Konsumentenkarten... Gamerwunschträume.... die sich nicht erfüllen werdne "NV bitte, bitte bitte.... wen schon keine 5090, bitte ne kastrierte 5080ti..."

Ne ist unsinn... GB202 sind kostbar... und solange NV daraus das
1784316744542.png

oder das
1784316779714.png



zimmern können, werden die jeden verdammten GDDR7 den es gibt, direkt auf sowas kleben. Aber ja... sicher... gibt bestimmt szenarien wo vielciht beides nicht in frage kommt. Dann wird daraus weiter ein 5090 werden, weil das die einzige LLM fähige Consumer Karte bleibt, und die einzige günstige "alternative" zu den Workstationkraten... das die 4-5k Wert ist, verdanken die ja nciht irgendwelchen verrückten Gamern. Daher warum sollten die den GB202, der sich dank lokal LLMs zu puren GOld verwandeln können, zu ner grüppel Gamer-Gpu machen. Ne sehe ich nicht.

Sry, wollte nicht die feuchten Träume so manches Entusiasten kaput machen. Aber NV geht richtig AI. Und wen NV auch wegen AI noch 4-5k aus nre 90er gedrückt bekommt, dann wird daraus NIEMALS eine 5080ti oder irgendwas... weil ich kann dafür ja ncihit mal mehr die hälfte verlangen....
Die 5090 reisen die Leute NV ja nur aus der Hand, weil sie nach den Workstationkarten das einzigste sind im große Lokale LLMs zu ballern. So leid es mir tut. Aber so wichtig sind wir Gamer nicht. :(
 
Zuletzt bearbeitet:
Sapphire Forum
Zurück
Oben