Wissen · Lokale KI

Qwen3 32B lokal betreiben: welche Hardware es braucht

Faktencheck: 3. September 2026 Fachlich verantwortlich: Daniel Bidoli Hersteller- und Ollama-Quellen unten

Die Stufe für Planung, Werkzeug-Auswahl und anspruchsvollere Agenten, ab der Workstation-Klasse.

Qwen3 32B ist der Schritt über das Arbeitspferd hinaus: bessere Planung, sauberere mehrstufige Analysen, tragfähigere Agenten. Die Modelldatei ist rund 20 GB gross; es braucht eine Grafikkarte ab 24 GB (etwa RTX 3090 oder 4090) oder einen Apple-Rechner ab 36 GB gemeinsamem Speicher.

Auf einen Blick

Was Qwen3 32B an Hardware braucht

Dieselben Einstufungen wie im Hardware-Rechner, hier für dieses eine Modell: Speicher, Anschaffen gegen Mieten, die passenden Anwendungsfälle und die Befehle zum Ausprobieren.

24–48 GB Grafikspeicher (VRAM)
32–64 GB Arbeitsspeicher (RAM)
20 GB Modelldatei (Q4)

Anschaffen

CHF 2'500–4'500 einmalig, Workstation

Mieten

CHF 150–300 pro Monat, GPU-Server

Passende Anwendungsfälle im Rechner

Braucht die Workstation-Klasse: Eine 24-GB-Karte (RTX 3090/4090) trägt es mit knappem Kontext, komfortabel sind 32 bis 48 GB Grafikspeicher oder ein Apple-Rechner ab 36 GB.

Tempo-Erwartung: Auf einer 24-GB-Karte ordentliches Lesetempo, spürbar bedächtiger als die 14B-Klasse. Auf Apple brauchbar, mit Geduld.

So starten Sie: die Befehle zum Kopieren

Ollama installieren (kostenlos, ollama.com), dann im Terminal:

ollama pull qwen3:32b
ollama run qwen3:32b

Q4-Planungswerte aus unserer internen Ollama-Hardware-Matrix, geprüft am 3. September 2026. Auf Apple-Rechnern teilen sich Modell und System den gemeinsamen Speicher, dort zählt die RAM-Angabe. Preise sind grobe Marktgrössenordnungen, keine Offerten.

Zum Nachschlagen

Qwen3 32B: alle Angaben im Detail

Geprüft am 3. September 2026. Kontextlänge, Parallelität, Bilddaten und Quantisierung verändern den tatsächlichen Bedarf; jede Zahl lässt sich gegen die Primärquellen unten prüfen.

ModellklasseObere Mittelklasse (27–35B) · Qwen3-Familie (Alibaba)
Parameter32,8 Milliarden
Modelldateirund 20 GB (Q4, GGUF)
Grafikspeicher (VRAM)24–48 GB
Arbeitsspeicher (RAM)32–64 GB
Apple (gemeinsamer Speicher)ab 36 GB, komfortabel 48–64 GB
Kontextfensterbis 32'000 Tokens
LizenzApache 2.0, auch kommerziell frei
Ollama-Nameqwen3:32b

Einordnung

Wo Qwen3 32B zwischen seinen Nachbarn steht

Alle Modellprofile unserer Matrix, vom kleinsten zum grössten. Die Stufe entscheidet über die Hardware, und der ehrliche Weg führt von klein nach gross: erst testen, dann aufrüsten.

Qwen3 14B — die Stufe darunter, reicht für die meisten Dokumentenaufgaben

GPT-OSS 20B — agentisch ausgelegt, läuft schon in 16 GB

Qwen3.8 27B — der aktuelle multimodale Nachfolger für Coding und Agenten

Hardware-Rechner — alle Stufen, Anwendungsfälle und der Umkehr-Modus «Was kann meine Hardware?»

Ehrlich eingeordnet

Wofür Qwen3 32B taugt, und wo die Grenzen liegen

Wofür es sich lohnt

In der oberen Mittelklasse (27 bis 35 Milliarden Parameter) wird lokale KI belastbar für Aufgaben mit mehreren Arbeitsschritten: Planung, Werkzeug-Auswahl in Agenten-Aufbauten, längere Arbeitsketten, anspruchsvollere Auswertungen. Qwen3 32B ist der übliche Vertreter dieser Stufe und läuft auf einer einzelnen 24-GB-Karte, also noch auf Hardware, die man kaufen kann, ohne mit dem Rechenzentrum zu verhandeln.

Wo die Grenzen liegen

Auf 24 GB läuft das Modell mit knappem Kontext: Die Datei belegt rund 20 GB, für lange Dokumente oder Agenten mit grossem Arbeitsgedächtnis wird es eng, dann sind 32 bis 48 GB die ehrliche Ansage. Und der wichtigste Rat aus unserer Beratungspraxis: Die 32B-Klasse lohnt sich erst, wenn die 14B-Klasse an den echten Aufgaben nachweislich scheitert. Dieser Nachweis kostet nichts, beide Modelle sind gratis, der Hardware-Unterschied ist es nicht.

Häufige Fragen

FAQ: Qwen3 32B lokal

Reichen 24 GB VRAM (RTX 3090/4090) für Qwen3 32B?

Ja, mit knappem Kontext: Die Q4-Modelldatei belegt rund 20 GB, damit bleibt auf einer 24-GB-Karte Platz für kürzere Aufträge. Für lange Dokumente oder Agenten mit viel Arbeitsgedächtnis sind 32 bis 48 GB Grafikspeicher die entspanntere Auslegung, etwa über zwei Karten oder eine Profi-Karte.

Läuft Qwen3 32B auf einem Mac?

Ab rund 36 GB gemeinsamem Speicher ja, komfortabel wird es ab 48 bis 64 GB, etwa auf einem Mac Studio. Das Tempo hängt an der Speicherbandbreite des Geräts und liegt unter dem einer dedizierten Grafikkarte; für Dokumenten- und Agentenarbeit im Hintergrund ist es meist gut genug.

Lohnt sich Qwen3 32B gegenüber 14B?

Nur, wenn die 14B-Klasse an den echten Aufgaben nachweislich scheitert, typischerweise bei Planung, mehrstufigen Arbeitsketten und Agenten. Für Zusammenfassen, Auslesen und interne Suche ist der Qualitätsgewinn selten den doppelten Hardware-Bedarf wert. Beide Modelle sind gratis: erst testen, dann Hardware kaufen.

Darf ich Qwen3 32B geschäftlich nutzen?

Ja. Wie die ganze Qwen3-Familie steht es unter der Apache-2.0-Lizenz und ist auch kommerziell frei nutzbar.

Primärquellen zum Nachprüfen

Passt Qwen3 32B zu Ihrer Aufgabe?

Das klärt kein Datenblatt, sondern ein Test mit Ihren echten Unterlagen. Im kostenlosen Erstgespräch grenzen wir die Aufgabe ab und sagen ehrlich, ob lokale KI der richtige Weg ist, oder ob es eine einfachere Antwort gibt. Erst messen, dann investieren.

Erstgespräch anfragen

Beschreiben Sie kurz, wo es hakt. Den Rest klären wir im Gespräch.

Daniel Bidoli, Inhaber von Bidoli IT-Services

Sie schreiben uns, was Sie beschäftigt. Ihre Nachricht landet nicht in einem Ticketsystem, sondern direkt bei Daniel Bidoli, dem Inhaber.

  1. Nachricht senden

    Zwei Sätze reichen, das Eingrenzen ist unsere Arbeit.

  2. Persönliche Antwort

    Erste Einschätzung innerhalb von 24 Stunden.

  3. Kostenloses Erstgespräch

    Rund 30 Minuten: online, vor Ort oder flexibel am Abend. Danach entscheiden Sie.

Sehen wir keinen Nutzen, sagen wir es Ihnen offen.

Lieber direkt sprechen?

+41 76 753 37 86 · WhatsApp

Ihre Anfrage

Was beschäftigt Sie? Eine kurze Beschreibung reicht, wir melden uns innerhalb von 24 Stunden.

Antwort in der Regel innerhalb von 24 Stunden.