ETI1120 schrieb:
Ich habe Dir nicht widersprochen
Ich weiß, du warst nicht gemeint. Es gab aber immer wieder - und ich will Namen nicht nennen - die steif und fest behauptet haben, dass ja GCN wieder kommt. Und bei PCGH trifft das nicht nur User, sondern etwas bekanntere Gesichter. Auch quasi bis quasi heute nacht. Nun ist mit GFX12.5 quasi die Bestätigung da, was UDNA sein wird => RDNA.
Und aus UDNA leiten sie ab jetzt CDNA und RDNA ab. Wichtige Eigenschaften, die in beiden Bereichen wichtig sind, werden ab jetzt als UDNA entwickelt und mit Ableitungen - zum Beispiel in dem man Datentypen beschneidet und Co - kann man dann RDNA und CDNA dann daraus destilieren.
ETI1120 schrieb:
Der Witz ist, je mehr ich von der ganzen Geschichte verstanden habe, desto offensichtlicher wurde, dass Deine Argumente richtig waren
Ich hab mir halt auch mal die Änderungen am LLVM als auch Mesa3D angesehen, dann auch das, was da mit dem VOPD und Co kamen.
@MichaG hat mir sogar mal absichtlich eine Nachricht geschickt, ich bin dann rein in das LLVM-Repository, hab mir da die Punkte angesehen und festgestellt: Eigentlich hat das keinen Wert darüber zu berichten, weil es einfach primär für die Entwickler von Mesa3D und eben ROCm wichtig ist, daraus jedoch eine Prognose zur Leistung aufzubauen - wie die Leaker als auch andere Seiten machten - dafür war es viel zu dünn! Änderungen an dem Dual-Vector-Operations sind spannend, wenn man sich mal mit Treiberbau befassen will, darüber hinaus ist es allerdings schwere Kost, bei der man bei Leistungsanalysen für Games und KI nur verlieren kann.
ETI1120 schrieb:
Das ist das Problem mit der Gerüchteküche, viele Leute verbreiten mit Inbrunst Dinge, die sie im Grunde nicht verstehen.
Das ist mit das größte Problem dabei, viele Leaker bekommen am Ende des Tages irgendwelche eckdaten zugeschanzt, können diese aber oft nur bedingt richtig einordnen. Aber gerade bei AMD ist es relativ die Gerüchte auch zu prüfen und mit gewissen wirklich vorhanden "Leaks" sogar zu verbinden:
https://gitlab.freedesktop.org/mesa/mesa/-/tree/main/src/amd?ref_type=heads
https://github.com/ROCm/llvm-project/tree/amd-staging/llvm/test/MC/AMDGPU
Und man kann hieraus sogar schon ableiten, dass gfx13 als nöchste Version ebenso ein deutlich größeres Registerfile haben wird, als ohnehin schon.
ETI1120 schrieb:
IMO kommt ein Faktor hinzu. ROCm. AMD hat ROCm mit einer sehr dünnen Personaldecke hochgezogen und ROCm war sehr an die Hardware gebunden.
Klar, war das damals auch eine Personal frage. Zu mal RDNA ja weiterhin Wave64 verarbeiten konnte.
ETI1120 schrieb:
Dasselbe gilt auch für die Zusammenarbeit von AMD mit Meta, AMD mit OpenAI
Japp, Triton zu nennen.
ETI1120 schrieb:
Auch bei der Architektur Entscheidungen getroffen die näher zu NVIDIA gehen.
Ja, wobei man hier sagen muss, dass AMD aktuell hier sogar eine echt geschickte Schiene fährt: Nvidia gibt vor, AMD zieht nach und verbessert dann an den Punkten, bei denen Nvidia auf "stur" stellt und quasi den Entwicklern sagt: Ne, wir machen das so, lebt damit. Entsprechend geht AMD bei den Kooperationen mit quasi jeder Firma als "Juniorpartner" rein und sagt: Sagt uns, was ihr von uns in der Hardware wollt, welche Kanten sollen wir schleifen.
Und ja, Nvidia reagiert aktuell darauf, aber alleine das OpenAI und quasi alle großen KI-Firmen angefangen haben eigene Frameworks zu schrieben, um sich von den Herstellern zu lösen und freier zu agieren. Allerdings ist auch das eine Sache, die ich bereits seit 3 - 4 Jahren in dem Beriech beobachte und auch geschrieben hatte.
ETI1120 schrieb:
Alle aktuellen Grafikkarten laufen unter ROCm. Alle aktuelle APUs laufen unter ROCm.
AMD hat ROCm massiv aufgewertet und arbeitet hier an allen Ecken daran. ROCm ist quasi das "Herz" der g
ETI1120 schrieb:
AMD nennt das was vorher die CU war in GFX125x auch nicht mehr CU sondern nur noch SIMD32pair.
Was an der Stelle auch logisch ist. Viele Aufgaben, die vorher ja pro CU "separat" bei GCN erledigt wurden, sind bereits mit RDNA in die WGP verlagert worden, während gleichzeitig bestimmte Aspekte dafür in der CU "ausgebaut" wurden, weil der Platz dafür vorhanden war.
AMD hat ja bei RDNA die CU auf zwei Wave-Fronten reduziert, sie haben die Wave-Verwaltung der CU heraus gelöst und als WGP-Schicht drüber gesetzt. Die Wave-Verwaltung der CU war auf 4 Wave-Fronten ausgelegt, also musste man diese quasi nicht wirklich "anpassen" und konnte den Platz der zweiten Wave-Verwaltung für andere Sachen nutzen.
Es ist schon teilweise erstaunlich, wie genial AMDs GPU und CPU Architekten sind und was die für Kniffe finden.