# #148 - Eure Antwort: lokale KI-Modelle, die euch keiner verbieten kann (Teil 2) Page: https://stenobird.com/podcast/das-ki-kochbuch-mit-malcolm-werchota-7394882/148-eure-antwort-lokale-ki-modelle-die-euch-keiner-verbieten-kann-teil-2 Text version: https://stenobird.com/podcast/das-ki-kochbuch-mit-malcolm-werchota-7394882/148-eure-antwort-lokale-ki-modelle-die-euch-keiner-verbieten-kann-teil-2.md Podcast: [Das KI-Kochbuch mit Malcolm Werchota](https://stenobird.com/podcast/das-ki-kochbuch-mit-malcolm-werchota-7394882) Published: 2026-07-07T02:00:00+00:00 Episode link: https://share.transistor.fm/s/875aaa80 Audio file: https://media.transistor.fm/875aaa80/2eaea6c5.mp3 Processing state: not_requested JSON: https://stenobird.com/v1/public/podcasts/das-ki-kochbuch-mit-malcolm-werchota-7394882/episodes/148-eure-antwort-lokale-ki-modelle-die-euch-keiner-verbieten-kann-teil-2 Duration seconds: 1166 ## Resource Title: #148 - Eure Antwort: lokale KI-Modelle, die euch keiner verbieten kann (Teil 2) Teil 1 war das Drama: Fable 5 nach drei Tagen abgeschaltet, dasselbe Spiel jetzt mit GPT-5.6, und wir in Europa stehen da ohne Lösung. Teil 2 ist die Antwort. Und die ist nicht „warten, bis die Amerikaner uns wieder ein Modell geben" — sondern „fahrt eure eigenen Modelle, in eurem Serverraum, auf eurem Laptop, und keiner kann sie euch wegnehmen". Action, let's go. 📍 Worum es heute geht: Open-Weight-Modelle wie Gemma 4, Qwen, DeepSeek V3/V4 und Mistral Nemo laufen heute lokal — ohne Internet, ohne dass eure Daten das Gebäude verlassen. Ein bisschen schlechter als die Frontier-Modelle, ja. Aber „ein bisschen schlechter" heißt in der KI-Welt 10-20 % schlechter — und das reicht vollkommen für das, was ihr wirklich macht. Diese Folge zeigt euch die Hardware, den Ein-Zeilen-Setup, den DSGVO-Vorteil und was ihr am Montag früh als CTO, CFO und Vorstand konkret tut. 📊 Erst mal vergleichen. Es gibt ein Paper, das zeigt, wie man die Modelle gegeneinander aufstellt: unten die Kosten, um das Modell laufen zu lassen, links die Evaluierung über mehrere Benchmarks — Mathematik, Coding, Reasoning. Da seht ihr Gemma 4, Qwen 3.7 und Co. Klar, auf der Coding-Benchmark liegt ein Qwen 2.5 bei 30 % und ein Fable 5 bei 80 %. Aber für eure Workflows — Angebote durchlesen, E-Mails schreiben, beim Coden helfen, in mehreren Sprachen arbeiten — braucht ihr kein Frontier-Modell. Das können die Offenen alle. 🛠️ Der Ein-Zeilen-Trick. Wisst ihr, wie ihr so ein Modell aufsetzt? Ihr macht Claude Code oder Codex auf und tippt: „Ich möchte Gemma 4 hier auf meinem PC ohne Internet nutzen. Mach mal." Das war der ganze Prompt. Dann läuft das Ding circa 10 Minuten, lädt sich Ollama runter, zieht das Modell, deployt es — fer… ## Actions - request_transcript: `POST https://stenobird.com/v1/public/podcasts/das-ki-kochbuch-mit-malcolm-werchota-7394882/episodes/148-eure-antwort-lokale-ki-modelle-die-euch-keiner-verbieten-kann-teil-2/transcription-requests` — Idempotently request low-priority transcript generation for this episode. - read_markdown: `GET https://stenobird.com/podcast/das-ki-kochbuch-mit-malcolm-werchota-7394882/148-eure-antwort-lokale-ki-modelle-die-euch-keiner-verbieten-kann-teil-2.md` — Read the agent-friendly Markdown representation of this episode resource. A page view does not enqueue transcription. Agents should invoke `request_transcript` explicitly when they need this episode processed. ## Transcript Full transcripts are not published on public pages unless there is a clear rights basis.