Eigentlich bringt NVIDIA so alle 2 Jahre eine neue Architektur für Rechenbeschleuniger heraus:
https://www.nvidia.com/en-us/technologies/
Die Consumber GPUs RTX50xx sind Blackwell Architekturen. Es gibt aber bei den Rechenbeschleuniger schon die Rubin-Architektur:
https://developer.nvidia.com/blog/inside-nvidia-rubin-gpu-architecture-powering-the-era-of-agentic-ai/
Die Frage ist, wann kommt die für die Consumer-Karten und sinken dann die Preise für die RTX50xx?
Allenfalls ist ein Nvidia oder AI Forum oder so passender fuer etwas Gossip.
Die Frage ist, wann kommt die für die Consumer-Karten
Wenn TSMC nicht mehr so stark überbucht ist, und die RAM-Preise wieder sinken.
Vorher macht das wenig Sinn für Nvidia.
Aktuelle Generation: ein Wafer mit 30 KI-Beschleunigern kostet dasselbe wie einer mit 70 Grafikchips (unter 20k $, 4N/4NP-Prozess, 300mm Wafer), aber einer bringt >20× soviel Gewinn.
Nvidia verkauft Grafikkarten nur noch zur Reste-Verwertung:
Chips mit Defekten kriegen einfach die betroffenen CUs deaktiviert und wandern in den Consumer-Grafikkarten-Markt.
So kriegt Nvidia den erstaunlich hohen Yield hin.
Und je besser TSMC den Prozess beherrscht, desto weniger Grafikkarten gibt es...
und sinken dann die Preise für die RTX50xx
Wenn die RTX60xx in Volumen am Markt sind (schätze frühestens Q3-4 2027), dann beginnen die Preise für die RTX50xx zu sinken. Aber vorher können die durchaus noch gewaltig steigen.
Blick in die Glaskugel: Im Dezember 2027 sinkt der Preis für eine RTX5090 von 9999€ auf 9949€, rechtzeitig für's Weihnachtgeschäft.
Bringt dir diese Vorhersage jetzt was?
Blick in die Glaskugel: Im Dezember 2027 sinkt der Preis für eine RTX5090 von 9999€ auf 9949€, rechtzeitig für's Weihnachtgeschäft.
Der Preis für die RTX5090 ist wirklich extrem gestiegen:
https://www.reddit.com/r/KI_engineering_de/comments/1vp3z3i/extreme_preissteigerung_bei_graphikkarten/
Selbst die RTX5070 von denen ich gerne eine hätte, sind jetzt eigentlich zu teuer.
Wenn die RTX60xx in Volumen am Markt sind (schätze frühestens Q3-4 2027), dann beginnen die Preise für die RTX50xx zu sinken. Aber vorher können die durchaus noch gewaltig steigen.
Mittlerweile habe ich mir das genauer angesehen, es gibt dieses Video dazu:
https://www.youtube.com/watch?v=e3PIvqig1MM
Wenn ich das richtig sehe, gehören da 6 Chips zusammen und da denke ich nicht, dass die 6 Chips auf eine Consumer-Karte packen.
Wenn ich das richtig sehe, gehören da 6 Chips zusammen und da denke ich nicht, dass die 6 Chips auf eine Consumer-Karte packen.
Hast du nicht. Nur 1 Chip davon ist die GPU mit HBM. Der Rest sind eine CPU und div. Datafabrics für Nvlink etc. Also haben 5 davon auf ner Grafikkarte nix zu suchen.
Selbst die RTX5070 von denen ich gerne eine hätte, sind jetzt eigentlich zu teuer.
Ich hab im Januar eine gebrauchte RTX 4090 gekauft und bin heil froh, dafür nur 1600 Euro bezahlt zu haben.
Ich hab im Januar eine gebrauchte RTX 4090 gekauft und bin heil froh, dafür nur 1600 Euro bezahlt zu haben.
Da hast du Glück gehabt, die liegen jetzt bei 3400€ (24GB). Die RTX4090 haben aber kein NVFP4, wenn ich es richtig weiß.
Da hast du Glück gehabt, die liegen jetzt bei 3400€ (24GB). Die RTX4090 haben aber kein NVFP4, wenn ich es richtig weiß.
Ja, ich hab auch ein gutes Jahr danach gesucht, bis ich endlich ein wirklich glaubwürdiges Angebot gefunden habe.
Dass sie mit der RTX 5090 nicht mithalten kann, ist klar, aber für lokale KI-Anwendungen ist der Unterschied nicht so enorm groß, dass es unbedingt die 50ger sein müsste. Und da ich keine AAA Titel spiele, ist mir MFG auch ziemlich egal.
Aber zum Thema: Ich bin mir ziemlich sicher, dass wir bei dem ganzen Datacenter-Hype nicht darauf hoffen dürfen, dass die nächsten Jahre SSD, RAM oder GPU wieder zu normalen Preisen verfügbar sein werden.
Aber zum Thema: Ich bin mir ziemlich sicher, dass wir bei dem ganzen Datacenter-Hype nicht darauf hoffen dürfen, dass die nächsten Jahre SSD, RAM oder GPU wieder zu normalen Preisen verfügbar sein werden.
Ich weiß nicht. Am Ende des Jahres sollen ja die Laptops mit den NVIDIA-GB10 Prozessoren heraus kommen, was ein Zeichen dafür ist, dass immer mehr KI-Anwendungen in die Konsumerhardware einziehen. Im Moment haben es die ganzen Speicherhersteller vermieden, ihre Produktionskapazitäten aufzustocken, weil es ja jederzeit passieren könnte, dass "die KI Blase" platzt. Wenn es sich aber abzeichnet, dass man dauerhaft mehr Speicher braucht, wird man auch mehr Fabriken bauen.
Lokale KI wird aber nicht mehr als eine nette Spielerei bleiben, weil brauchbare KI-Modelle einfach sehr viel großen Speicher brauchen.
Nimm doch nur mal GPT-OSS-120b. Das braucht ca. 80GB RAM. Wer soll das bezahlen wollen?
Es ist für die Videospiel-Branche bestimmt hart, einige Jahre mit der Hardware auszukommen, die bereits in den Wohnzimmern steht.
Lokale KI wird aber nicht mehr als eine nette Spielerei bleiben, weil brauchbare KI-Modelle einfach sehr viel großen Speicher brauchen.
Die großen Modelle sind und werden sicherlich besser sein. Allerdings auch teurer und weniger privat.
Ich nutze einige lokale Modelle auf der Spark-DGX zum als Coding-Unterstützung und finde es gar nicht mal so schlecht.
Und wer gut programmieren kann und ein wenig tiefer einsteigen will, kann sich auch seinen eigenen Coding-Agenten bauen, dann weiß man wenigstens, was der macht:
https://www.reddit.com/r/KI_engineering_de/comments/1vxt9e0/coding_agent_selbst_entwickeln/
Die Frage ist, wann kommt die für die Consumer-Karten und sinken dann die Preise für die RTX50xx?
Die Preise sinken sobald der ganze KI Hype zusammenbricht und die grossen Rechnenzentren zumachen weil alle nur lokal rechnen wollen. Bild dir eine Meinung wann das passiert. :-D
Ich rechne in 1-2 Jahren damit....
Hilfreich ist es aber IMHO von Nvidia die Finger zu lassen und AMD zu kaufen. Ich nutze z.B eine RX9060XT 16GB. (hat 400Euro gekostet)
Warum? AMD ist vermutlich im Spielesektor nicht ganz so gut wie Nvidia, aber wir wollen ja nicht spielen, daher preiswerter. AMD hatte bisher den Ruf nicht gut wegen KI/Treiber usw zu sein. Aber das hat sich in den letzten sechs Monaten geaendert. Meine Karte faehrt zwar beim denken auch ihre Luefter hoch, aber noch in einem bescheidenen Rahmen. Wer ernsthaft KI nutzen will der wird ueber kurz oder lang vermutlich einen Server in der Ecke/Keller haben und auf Servern laeuft sowieso Linux und da ist die Unterstuetzung VIEL besser und schmerzfreier wie bei Nvidia.
Noch was zur Geschwindigkeit. Man will gerne moeglichst viel VRAM haben wegen groesseren Modellen die dann intelligenter sind. Ich schaetze mal so bei 64GB wird der Sweetspot liegen. Man braucht aber nicht unbedingt fuer privat eine schnellere Grafikkarte solange man nur 1-2 Nutzer auf dem System hat. Das ist natuerlich anders wenn man eine ganze Firma versorgen will!
Vanye
Ich nutze z.B eine RX9060XT 16GB. (hat 400Euro gekostet)
Hier ist der graphische Vergleich der AMD-Karten:
https://www.reddit.com/media?url=https%3A%2F%2Fcf.preview.redd.it%2Fn0fxsch0yjkh1.png%3Fwidth%3D1400%26format%3Dpng%26auto%3Dwebp%26s%3Da6bc08c37a75d116168c5c8d3e841cc1740fe638
Zur Speicherbandbreite einer R9700 zu RTX5090: "Die Nvidia GeForce RTX 5090 bietet eine Speicherbandbreite von 1.792 GB/s, während die AMD Radeon AI Pro R9700 (z. B. von PowerColor oder Sapphire) bei ca. 640 bis 645 GB/s liegt"
Antwort schreiben
Bitte melde dich an, um einen Beitrag zu schreiben.