Wissen · Lokale KI
Die lokale ChatGPT-Alternative: Texte und Chat, ohne dass ein Wort das Haus verlässt
Faktencheck: 3. September 2026 Fachlich verantwortlich: Daniel Bidoli Modell- und Hardwarequellen unten
ChatGPT selbst läuft nur in der Cloud. Offene Modelle erledigen die Alltags-Texte auf Ihrer eigenen Maschine.
E-Mails entwerfen, Texte umformulieren, übersetzen, zusammenfassen: Für die Alltags-Schreibarbeit reicht ein aktuelles offenes Modell wie Qwen3.5 4B oder 9B erstaunlich oft. Der kleine Tag läuft auf Hardware, die vielerorts schon dasteht; 9B liefert mehr Qualität und braucht auf 8 GB VRAM kurzen Kontext.
Auf einen Blick
Was «Texte schreiben & Chat» an Hardware braucht
Dieselben Einstufungen wie im Hardware-Rechner, hier zum Nachlesen: Speicher, Anschaffen gegen Mieten, die passenden Modelle und die Befehle zum Ausprobieren.
Q4-Planungswerte aus unserer internen Ollama-Hardware-Matrix, geprüft am 3. September 2026.
Anschaffen
CHF 900–1'400 einmalig, passender PCMieten
CHF 60–120 pro Monat, kleiner GPU-ServerWomit Sie starten können
Läuft auf einer 8-GB-Grafikkarte (z. B. RTX 4060) oder einem Apple-Rechner ab 16 GB Speicher, den viele Betriebe schon haben. Zur Not auch ganz ohne Grafikkarte über den Hauptspeicher, dann deutlich langsamer.
Tempo-Erwartung: Auf einer Grafikkarte flüssiges Lesetempo, auf Apple gut, rein über die CPU zäh.
So starten Sie: die Befehle zum Kopieren
Ollama installieren (kostenlos, ollama.com), dann im Terminal:
ollama pull qwen3:8b ollama run qwen3:8b # Für schwächere Rechner oder den ersten Versuch: ollama pull qwen3:4b
Auf Apple-Rechnern teilen sich Modell und System den gemeinsamen Speicher, dort zählt die RAM-Angabe. Preise sind grobe Marktgrössenordnungen, keine Offerten.
Im Betrieb
Was damit möglich ist
E-Mail-Entwürfe
Aus Stichworten wird ein sauberer Entwurf, aus einer verärgerten Antwort eine professionelle. Der Text entsteht auf Ihrer Maschine; was Kunden- oder Personalnamen enthält, hat nie einen fremden Server gesehen.
Umformulieren und Korrigieren
Offerten glätten, Berichte kürzen, den richtigen Ton treffen: das tägliche Kleinzeug der Schreibarbeit, für das niemand ein Cloud-Konto mit Firmentexten füttern möchte.
Übersetzungen für den Alltag
Deutsch, Englisch, Französisch, Italienisch: Die offenen Modelle sind mehrsprachig trainiert und übersetzen Geschäftskorrespondenz ordentlich, für Verträge bleibt der Profi zuständig.
Zusammenfassen im Vorbeigehen
Der lange Mail-Verlauf, das Sitzungsdokument, der Artikel: kurz zusammengefasst, bevor Sie entscheiden, ob sich das ganze Lesen lohnt.
Ehrlich eingeordnet
Warum lokal, und wo die Grenzen liegen
Warum gerade hier lokal
Der Chat-Assistent ist das KI-Werkzeug mit dem höchsten Risiko für stille Datenabflüsse: Er wird mit allem gefüttert, was gerade auf dem Tisch liegt, Kundennamen, Zahlen, Personalthemen, oft ohne dass jemand darüber nachdenkt. Ein lokales Modell macht diese Frage gegenstandslos: Was Sie eintippen, bleibt auf Ihrer Maschine, ohne Konto, ohne Protokoll bei einem Anbieter, ohne die Frage, was mit den Eingaben trainiert wird.
Die ehrlichen Grenzen
Die ehrliche Einordnung: ChatGPT, Claude und Gemini selbst laufen ausschliesslich in der Cloud ihrer Anbieter, lokal laufen offene Modelle, und die erreichen deren Spitzenleistung nicht. Für anspruchsvolle Texte, komplexe Argumentation und die letzten fünf Prozent Eleganz bleiben die grossen Cloud-Modelle vorn. Für den Werkalltag aus Entwürfen, Umformulierungen und Zusammenfassungen ist der Abstand aber kleiner, als die meisten erwarten, und genau das prüft man am besten mit den eigenen Texten.
Der Weg
So kommt das in Ihren Betrieb
Die ersten Schritte kosten nichts ausser etwas Zeit; investiert wird erst, wenn der eigene Test den Nutzen belegt hat.
-
In zehn Minuten zum ersten Ergebnis
Ollama installieren, Qwen3.5 4B laden, eine echte E-Mail aus dem Alltag entwerfen lassen. Für lokale Modelle braucht es kein Konto, keine Kreditkarte und kein Abo.
-
Mit den eigenen Texten vergleichen
Eine Woche lang die Alltags-Schreibarbeit parallel erledigen: Was schafft das lokale Modell, wo fehlt die Klasse der Cloud? Danach wissen Sie es, statt es zu glauben.
-
Ins Team bringen
Ein gemeinsamer Zugang im Haus, angebunden an Vorlagen und Ablage, statt zwanzig privater Cloud-Konten: Das ist der Punkt, an dem aus dem Werkzeug ein Betriebsmittel wird, und unser Teil der Arbeit.
Häufige Fragen
FAQ: Texte & Chat mit lokaler KI
Kann ich ChatGPT lokal auf meinem Rechner installieren?
Nein, ChatGPT läuft ausschliesslich in der Cloud von OpenAI. Lokal laufen offene Modelle wie Qwen3, Llama oder GPT-OSS, am einfachsten über das freie Werkzeug Ollama. Sie erreichen nicht die Spitzenleistung der grossen Cloud-Modelle, für Alltags-Texte wie E-Mails, Entwürfe und Zusammenfassungen reichen sie aber erstaunlich oft.
Wie gut schreiben lokale Modelle auf Deutsch?
Gut brauchbar: Die aktuellen offenen Modelle sind mehrsprachig trainiert, Entwürfe, Umformulierungen und Zusammenfassungen funktionieren zuverlässig. Bei feinen Nuancen und Schweizer Eigenheiten lohnt der Test mit den eigenen Texten, genau dafür ist das kostenlose Ausprobieren da.
Welche Hardware braucht ein lokaler Chat-Assistent?
Weniger als jeder andere KI-Anwendungsfall: eine Grafikkarte mit 8 GB (z. B. RTX 4060) oder ein Apple-Rechner ab 16 GB gemeinsamem Speicher. Zum Ausprobieren reicht sogar ein gewöhnlicher Büro-Rechner ohne Grafikkarte, dann kommen die Antworten spürbar langsamer.
Lohnt sich lokal statt eines ChatGPT-Abos?
Über die Kosten selten: Ein Abo ist günstig, und der Rechner daneben kostet Abschreibung. Die echten Gründe sind Datenschutz (keine Firmentexte bei einem Drittanbieter), Unabhängigkeit von Preis- und Produktänderungen und die Möglichkeit, das Modell an die eigene Ablage und die eigenen Abläufe anzubinden. Wer keinen dieser Gründe hat, fährt mit dem Abo einfacher.
Quellen und Vertiefung
- Qwen3 in der Ollama-Bibliothek — die Modelle hinter dieser Seite
- Ollama — der einfachste Einstieg, Windows, Mac und Linux
- Modellprofil: Qwen3 8B — alle Zahlen und Grenzen des empfohlenen Modells
- Modellprofil: Qwen3 4B — alle Zahlen und Grenzen des empfohlenen Modells
Weitere Anwendungsfälle
Was lokale KI sonst noch kann
Alle neun Fälle aus dem Rechner
Fälle mit Pfeil öffnen den Rechner an der richtigen Stelle; die übrigen haben eine eigene Seite wie diese.
Nächster Schritt
Passt das zu Ihrem Betrieb?
Im kostenlosen Erstgespräch klären wir, ob «Texte & Chat» bei Ihnen den Aufwand lohnt, welche Hardware wirklich nötig ist, und ob die ehrliche Antwort vielleicht «Cloud» oder «noch nicht» lautet. Wenn ja, folgt die Analyse zum Festpreis: Aufgabe abgrenzen, Modell testen, Absicherung planen. Erst messen, dann investieren.
Beschreiben Sie kurz, wo es hakt. Den Rest klären wir im Gespräch.
Sie schreiben uns, was Sie beschäftigt. Ihre Nachricht landet nicht in einem Ticketsystem, sondern direkt bei Daniel Bidoli, dem Inhaber.
-
Nachricht senden
Zwei Sätze reichen, das Eingrenzen ist unsere Arbeit.
-
Persönliche Antwort
Erste Einschätzung innerhalb von 24 Stunden.
-
Kostenloses Erstgespräch
Rund 30 Minuten: online, vor Ort oder flexibel am Abend. Danach entscheiden Sie.
Sehen wir keinen Nutzen, sagen wir es Ihnen offen.
Lieber direkt sprechen?
Ihre Anfrage
Was beschäftigt Sie? Eine kurze Beschreibung reicht, wir melden uns innerhalb von 24 Stunden.