Published on

RTX 3090 gebraucht: 24 GB für lokale KI

Authors

RTX 3090 gebraucht: 24 GB für lokale KI

TL;DR

Die gebrauchte RTX 3090 bleibt 2026 die günstigste Art, 24 GB auf den Schreibtisch zu legen — oft unter 1.000 €. Genau diese Stufe trägt ein dichtes 27B-Modell in Q4, ohne MoE-Kompromiss. Es ist keine Datacenter-Karte: 350 W, drei Slots, kein ECC, Treiber- und Kühlungsgeschichte vom Vorbesitzer. Wer 24/7 im Serverraum fährt, rechnet Strom gegen eine L4/L40S. Wer lokal Agents testen will, ist mit einer geprüften 3090 oft besser bedient als mit einer neuen 16-GB-Karte.

Warum 24 GB die Stufe ist: Lokale KI 2026: GPU-Wahl 16 GB vs. 24 GB. Budget unter 1.000 € gesamt: Lokale KI unter 1.000 Euro.

Was Sie kaufen — und was nicht

RTX 3090 gebrauchtRTX 4090RTX 5090
VRAM24 GB GDDR6X24 GB GDDR6X32 GB GDDR7
Typische RolleSweet Spot Q4-27BSchneller bei gleichem VRAM70B-Q4-Klasse
TGP350 W450 W575 W
Form3 Slots, Desktop3 Slots3+ Slots
24/7-Servernur mit guter Kühlungeher neineher nein

Die 3090 gewinnt den Euro-pro-Gigabyte-Vergleich, nicht den Tokens/Sekunde- Vergleich gegen 4090/5090. Für llama.cpp und Ollama auf einem Arbeitsplatz reicht der Abstand oft. Für parallele Nutzer zählt Bandbreite — dann die 4090.

50er-Serie in GB: RTX 5090 VRAM.

Checkliste vor der Überweisung

  1. Foto vom PCB und den Lüftern. Staubkrater, fehlende Pads, gebogene Heat- pipes sind Ausschluss, kein Verhandlungshebel.
  2. Mining und 24/7-Render. Stunden im fünfstelligen Bereich sind kein automatisches Tot, aber Preis und Garantie-Rest müssen passen. Nach Flashen des VBIOS fragen.
  3. Netzteil. 750 W sauber, besser 850 W, PCIe-Stecker nicht über Adapter daisy-chainen.
  4. Gehäuse-Luft. Drei Slots plus 350 W im Mini-ITX-Büro-PC ist ein Ofen.
  5. Test vor Bezahlung. Ein kurzer llama.cpp-Lauf (ein 7B, dann das Ziel- Quant) zeigt Artefakte früher als FurMark allein.

Ganze Server gebraucht — andere Lieferkette, andere Risiken: Gebrauchte GPU-Server kaufen.

Strom und Büro

350 W GPU plus CPU sind im Dauerbetrieb spürbar an der Steckdose und an der Klimatisierung des Raums. Die Jahresrechnung steht im KI-Server-Stromkosten. Für den Desktop-Pilot: Karte lastet nicht 24/7 auf TGP — trotzdem nicht in ein geschlossenes Slim-Gehäuse zwingen.

Wann Sie die 3090 liegen lassen

  • Sie brauchen ECC und Hersteller-Support im Rack.
  • Mehrere Teams, eine Karte, vLLM-Last — dann 4090 oder Workstation 48 GB.
  • Das Modell ist 70B Q4 ohne Split: 24 GB reichen nicht, siehe VRAM-Rechner.
  • Der Verkäufer liefert keine Seriennummer, kein Testvideo, Barzahlung nur abends am Parkplatz.

Häufige Fragen

Reicht Q4 auf der 3090 für Qwen 27B?

Ja, das ist der dokumentierte Sweet Spot der 24-GB-Klasse. Q5/Q8 brauchen Puffer für KV-Cache — langen Kontext extra rechnen, nicht nur die GGUF-Größe. Vertiefung: KV-Cache und GPU-Wahl.

3090 oder neue 16-GB-Karte?

Für dichte 27B: 3090. Für MoE und 14B-Klasse kann neue 16 GB (5080, 9070 XT) genügen und leiser sein. Die Stufe, nicht die Generation.

Wie lange hält eine gebrauchte 3090 noch?

Als Consumer-Karte ohne Enterprise-Ersatzteilvertrag: so lange Kühlung und VRAM fehlerfrei sind. Ein Ersatz vom Gebrauchtmarkt ist 2026 noch da — das ist Teil der Rechnung, kein Lebenszeit-Versprechen.

Fazit und nächster Schritt

Die gebrauchte 3090 ist 2026 keine Nostalgie, sondern die günstigste 24-GB- Tür in lokale Agents. Kaufen Sie die Karte nach Luft, Strom und Testlauf, nicht nach Mining-Meme.

Wenn Sie 3090, 4090 und 16-GB-AMD gegen dasselbe Modell legen wollen: Sprechen Sie uns an. Wir sizen nach VRAM und Last, nicht nach Baujahr.

📖 Verwandte Artikel

Weitere interessante Beiträge zu ähnlichen Themen