eine strukturiertere satzstellung , weniger ??? und zeichensetzung würden den post leserlich werden lassen . aber egal .
CPU (ungleich) GPU !
CPUs haben als ganzes längere Produktzyklen - es kommen mit der Zeit einfach überarbeitete Versionen desselben Floorplans heraus (sog. Steppings), welche dann durch Optimierung bessere Schaltgeschwindigkeiten erlauben. Dadurch und durch die geringere Parallelität können CPUs mit einem hohen Anteil an sogenannten Full Custom Transistoren geschaffen werden. Bei diesen wird zu großen Teilen manuell eine optimale Platzierung der einzelnen Schaltungen erreicht. Natürlich wird auch hier der riesige Cache bsw. dupliziert, aber die Recheneinheiten, Load/Store usw. sind schon "handgemacht".
GPUs haben eine viel kürzere Lebensdauer und einen massiv höhere Parallelität. Hier können und müssen die Designer mit vorgefertigten Blöcken (AND-Gate, Auffangregister etc.) arbeiten, um den Designzyklus einhalten zu können. Zusätzlich sind diese "Bausteine" (Bibliotheken, Libaries, Libs) meist auch noch an einen bestimmten Prozess gebunden (meist bei TSMC). Da gibt's dann optische Shrinks, bei denen diese Libs gleich bleiben (von 65 auf 55nm bsw.) und neue sog. Full Nodes (von 90 auf 65nm), bei denen sie sich ändern. Außerdem gibt's noch das Problem, dass die vielen parallelen Einheiten auch die Datenwege untereinander benötigen. Je mehr Einheiten, desto schwieriger wird's, alle untereinander optimal zu verbinden. Da gibt's dann Probleme, einen schnellen, sog. kritischen Pfad hinzubekommen. Dieser gibt die maximale Signallaufzeit auf dem Chip an und begrenzt die Taktfrequenz.