Cloud-KI vs. lokales LLM: Was wirklich für Selfhosting spricht
ChatGPT und Claude oder ein eigenes Modell auf dem Homeserver? Ein ehrlicher Vergleich entlang der Kriterien, die zählen: Antwortqualität, Datenschutz, Kosten, Verfügbarkeit — und warum die beste Antwort für die meisten „beides“ lautet.
Von Niclas Hennrich · Veröffentlicht: · 4 Min. Lesezeit
Kurz gesagt: Cloud-KI liefert die beste Antwortqualität, lokale LLMs liefern Kontrolle — über Daten, Kosten und Verfügbarkeit. Ein 8B-Modell auf dem Homeserver ersetzt kein Frontier-Modell, aber es beantwortet die Aufgaben, bei denen es auf Vertraulichkeit oder Dauerbetrieb ankommt: Dokumente zusammenfassen, die das Haus nicht verlassen sollen, Automationen, die rund um die Uhr laufen. Die für die meisten sinnvolle Antwort ist deshalb keine Entweder-oder-Entscheidung, sondern Arbeitsteilung: Cloud für Spitzenqualität, lokal für alles Vertrauliche und Dauerhafte.
Das ist dieselbe Abwägung, die Selfhoster von Cloud-Speicher vs. Nextcloud kennen — nur dass bei KI nicht Dateien wandern, sondern Prompts: also oft genau die Texte, Dokumente und Probleme, über die man gerade nachdenkt.
Worin die Cloud gewinnt #
Der Vergleich beginnt ehrlich — in drei Punkten ist die Cloud klar vorn:
- Antwortqualität. Die großen Modelle von OpenAI, Anthropic und Google spielen in einer anderen Liga als alles, was in Heim-Hardware-Speicher passt: besseres Schlussfolgern, weniger Halluzinationen, bessere Werkzeugnutzung, aktuellerer Wissensstand. Bei komplexen Aufgaben — anspruchsvoller Code, lange Analysen, heikle Formulierungen — ist der Unterschied nicht subtil.
- Null Einstiegshürde. Browser auf, loslegen. Keine Hardware-Fragen, keine Modellauswahl, keine Wartung.
- Tempo und Features. Cloud-Inferenz läuft auf Rechenzentren-GPUs; dazu kommen Websuche, Bildverständnis, Dokumenten-Tools und alles, was die Anbieter drumherum bauen.
Wer KI nur gelegentlich für anspruchsvolle Einzelaufgaben nutzt, ist mit einem Cloud-Zugang schlicht am besten bedient. Der Rest des Guides handelt von den Fällen, in denen das Bild kippt.
Worin lokal gewinnt #
Datenschutz: Der Prompt bleibt im Haus #
Das stärkste Argument. Bei einem lokalen Modell verlässt kein Prompt, kein Dokument und keine Antwort das eigene Netz — nicht als Trainingsdaten, nicht als Log, nicht als Metadaten. Es gibt keine AGB-Änderung, die das rückwirkend ändert, und keine Fehlkonfiguration auf fremder Seite.
Das verschiebt die Grenze dessen, was man einer KI überhaupt geben mag: Arztbriefe zusammenfassen, Verträge vergleichen, Finanzunterlagen sortieren, interne Konfigurationen analysieren — Aufgaben, die mit Cloud-KI entweder tabu sind oder ein mulmiges Gefühl hinterlassen, werden lokal unproblematisch. Für alle, deren Homelab ohnehin der Versuch ist, Daten wieder selbst zu besitzen, ist Local AI die konsequente Fortsetzung.
Kosten: planbar statt gemessen #
Cloud-KI bezahlst du als Abo oder pro Token — konkrete Preise nennen wir hier bewusst nicht, sie ändern sich schneller, als ein Guide altern sollte. Strukturell bleibt aber wahr: Cloud-Kosten skalieren mit der Nutzung, lokale Kosten nicht. Ein lokales Modell auf vorhandener Hardware kostet Strom während der Nutzung — bei einem sparsamen Setup Centbeträge, nachrechenbar mit dem Stromkosten-Rechner.
Die Gegenrechnung gehört ebenfalls dazu: Wird für Local AI eigens eine GPU gekauft oder läuft ein 300-Watt-Server dauerhaft mit, verschiebt sich die Rechnung deutlich — dieselbe Amortisationslogik wie beim Cloud-vs-Selfhosting-Rechner für Speicher. Für Dauerlast (Automationen, Batch-Verarbeitung) spricht die Struktur klar für lokal; für seltene Nutzung auf teurer Extra-Hardware klar dagegen.
Verfügbarkeit und Unabhängigkeit #
Ein lokales Modell funktioniert bei Internetausfall, kennt keine Rate Limits, keine Lastspitzen-Drosselung und keine Produktentscheidungen Dritter: Das Modell, das heute läuft, läuft in fünf Jahren identisch — kein „wir stellen dieses Modell zum Monatsende ein“. Für Automationen, die zuverlässig laufen sollen (etwa im Smart Home), ist diese Berechenbarkeit mehr wert als Spitzenqualität.
Basteln und Lernen #
Nicht zu unterschätzen für alle mit Homelab: Lokal kannst du Modelle frei tauschen, Parameter anfassen, eigene Pipelines bauen — und verstehst dabei, wie die Technik funktioniert, statt nur eine Weboberfläche zu bedienen.
Die Entscheidungsmatrix #
| Kriterium | Cloud-KI | Lokales LLM |
|---|---|---|
| Antwortqualität | ⬤ Frontier-Niveau | kleiner, merklich schwächer |
| Datenschutz | Vertrauen + AGB | ⬤ Daten bleiben im Netz |
| Kosten | skalieren mit Nutzung | ⬤ Strom (+ ggf. Hardware einmalig) |
| Verfügbarkeit | Internet + Anbieter | ⬤ offline, ohne Limits |
| Einstieg | ⬤ sofort | Hardware + Einrichtung |
| Aktualität des Wissens | ⬤ teils mit Websuche | eingefroren beim Training |
In der Praxis: Arbeitsteilung statt Glaubensfrage #
So sieht die Kombination aus, die sich im Alltag bewährt:
- Cloud für die Aufgaben, bei denen Qualität entscheidet und die Daten unkritisch sind: kniffliger Code, Recherche, lange Texte.
- Lokal für alles Vertrauliche (Dokumente, persönliche Daten, interne Configs) und alles Dauerhafte (Automationen, Zusammenfassungs-Jobs, Smart-Home-Anbindung) — eingerichtet in einer Stunde mit Ollama und Open WebUI.
Open WebUI macht die Arbeitsteilung sogar nahtlos: Es bindet neben Ollama auch OpenAI-kompatible Cloud-APIs ein — eine Oberfläche, pro Aufgabe das passende Modell.
Ob dein Server für den lokalen Teil reicht, beantwortet der Local-AI-Rechner — oft ist die Antwort besser als erwartet.
Häufige Fragen
- Ist ein lokales LLM so gut wie ChatGPT oder Claude?
- Nein — und das sollte man ehrlich einordnen: Die großen Cloud-Modelle sind den 7B–32B-Modellen, die auf Heimhardware laufen, bei komplexen Aufgaben klar überlegen. Lokale Modelle sind aber längst gut genug für viele Alltagsaufgaben: Zusammenfassen, Umformulieren, einfache Fragen, strukturierte Extraktion, Automationen im Smart Home. Die Frage ist nicht „genauso gut?“, sondern „gut genug wofür?“.
- Was kostet ein lokales LLM im Betrieb?
- Im Kern Strom plus gegebenenfalls einmalige Hardware: Ein Modell, das auf vorhandener Hardware läuft, kostet nur die Energie während der Nutzung — rechenbar mit unserem Stromkosten-Rechner. Teuer wird es erst, wenn eigens dafür eine GPU angeschafft wird oder ein stromhungriger Server dauerhaft läuft. Cloud-Preise (Abo oder API pro Token) ändern sich zu oft, um sie hier pauschal zu beziffern — vergleiche mit deinem tatsächlichen Nutzungsvolumen.
- Wann lohnt sich ein lokales Modell wirklich?
- In drei Fällen: wenn Daten das Haus nicht verlassen sollen (Dokumente, Gesundheit, Finanzen, Firmencode); wenn KI in Automationen dauerhaft mitläuft und pro-Token-Kosten oder Rate Limits stören würden; und wenn Unabhängigkeit zählt — ein lokales Modell verschwindet nicht durch eine Preisänderung, API-Abschaltung oder Internetstörung. Für gelegentliche Spitzenqualität bleibt die Cloud die pragmatische Wahl.
- Welche Daten sollte ich keiner Cloud-KI geben?
- Alles, was du auch sonst nicht hochladen würdest: Ausweis- und Vertragsdokumente, Gesundheitsdaten, Finanzunterlagen, Zugangsdaten und Konfigurationen mit Schlüsseln oder internen Adressen, fremde personenbezogene Daten und vertraulichen Quellcode. Genau diese Kategorien sind der stärkste Anwendungsfall für ein lokales Modell — dort bleibt der Prompt im eigenen Netz.
- Brauche ich fürs lokale Modell zwingend teure Hardware?
- Nein. Für den Einstieg reicht vorhandene Hardware: 16 GB RAM genügen für kleine Modelle auf der CPU, ein Mac mit Apple Silicon oder eine Gaming-GPU mit 8–12 GB VRAM machen 7–9B-Modelle flüssig nutzbar. Was konkret auf deinem System läuft, zeigt der Local-AI-Rechner.
Weiterlesen
KI & Local AI
Wie viel RAM und VRAM braucht ein LLM? Die ehrliche Rechnung
7B, 14B oder 70B lokal betreiben — wie viel VRAM, RAM oder Unified Memory braucht das wirklich? Die Faustformel hinter dem Speicherbedarf, geschätzte Werte pro Modellgröße und was GPU, Apple Silicon und CPU-only unterscheidet.
KI & Local AI
Ollama einrichten: Lokale LLMs auf Server, PC und Mac
Ollama installieren und das erste lokale Sprachmodell betreiben — nativ auf Linux, als Docker-Container oder auf dem Mac. Mit Modellverwaltung, API-Grundlagen und dem Sicherheits-Kapitel, das viele überspringen: Ollama hat keine Authentifizierung.
Selfhosting
Nextcloud selbst hosten: Lohnt sich das 2026 noch?
Nextcloud 34 selbst betreiben: was es wirklich an RAM, Platz und Zeit kostet, wo es überraschend langsam wird — und warum das naheliegende Backup-Verfahren sich bei uns nicht zurückspielen ließ. Mit nachgemessenen Werten aus dem eigenen Homelab.