Episode

#148 - Eure Antwort: lokale KI-Modelle, die euch keiner verbieten kann (Teil 2)

Podcast
Das KI-Kochbuch mit Malcolm Werchota
Published
Jul 7, 2026
Duration seconds
1166
Processing state
not_requested
Canonical source
https://share.transistor.fm/s/875aaa80
Audio
https://media.transistor.fm/875aaa80/2eaea6c5.mp3
JSON
/v1/public/podcasts/das-ki-kochbuch-mit-malcolm-werchota-7394882/episodes/148-eure-antwort-lokale-ki-modelle-die-euch-keiner-verbieten-kann-teil-2
Markdown
/podcast/das-ki-kochbuch-mit-malcolm-werchota-7394882/148-eure-antwort-lokale-ki-modelle-die-euch-keiner-verbieten-kann-teil-2.md

Actions

  • POST https://stenobird.com/v1/public/podcasts/das-ki-kochbuch-mit-malcolm-werchota-7394882/episodes/148-eure-antwort-lokale-ki-modelle-die-euch-keiner-verbieten-kann-teil-2/transcription-requests
    Idempotently request low-priority transcript generation for this episode.
  • GET https://stenobird.com/podcast/das-ki-kochbuch-mit-malcolm-werchota-7394882/148-eure-antwort-lokale-ki-modelle-die-euch-keiner-verbieten-kann-teil-2.md
    Read the agent-friendly Markdown representation of this episode resource.

Summary

Title: #148 - Eure Antwort: lokale KI-Modelle, die euch keiner verbieten kann (Teil 2) Teil 1 war das Drama: Fable 5 nach drei Tagen abgeschaltet, dasselbe Spiel jetzt mit GPT-5.6, und wir in Europa stehen da ohne Lösung. Teil 2 ist die Antwort. Und die ist nicht „warten, bis die Amerikaner uns wieder ein Modell geben" — sondern „fahrt eure eigenen Modelle, in eurem Serverraum, auf eurem Laptop, und keiner kann sie euch wegnehmen". Action, let's go. 📍 Worum es heute geht: Open-Weight-Modelle wie Gemma 4, Qwen, DeepSeek V3/V4 und Mistral Nemo laufen heute lokal — ohne Internet, ohne dass eure Daten das Gebäude verlassen. Ein bisschen schlechter als die Frontier-Modelle, ja. Aber „ein bisschen schlechter" heißt in der KI-Welt 10-20 % schlechter — und das reicht vollkommen für das, was ihr wirklich macht. Diese Folge zeigt euch die Hardware, den Ein-Zeilen-Setup, den DSGVO-Vorteil und was ihr am Montag früh als CTO, CFO und Vorstand konkret tut. 📊 Erst mal vergleichen. Es gibt ein Paper, das zeigt, wie man die Modelle gegeneinander aufstellt: unten die Kosten, um das Modell laufen zu lassen, links die Evaluierung über mehrere Benchmarks — Mathematik, Coding, Reasoning. Da seht ihr Gemma 4, Qwen 3.7 und Co. Klar, auf der Coding-Benchmark liegt ein Qwen 2.5 bei 30 % und ein Fable 5 bei 80 %. Aber für eure Workflows — Angebote durchlesen, E-Mails schreiben, beim Coden helfen, in mehreren Sprachen arbeiten — braucht ihr kein Frontier-Modell. Das können die Offenen alle. 🛠️ Der Ein-Zeilen-Trick. Wisst ihr, wie ihr so ein Modell aufsetzt? Ihr macht Claude Code oder Codex auf und tippt: „Ich möchte Gemma 4 hier auf meinem PC ohne Internet nutzen. Mach mal." Das war der ganze Prompt. Dann läuft das Ding circa 10 Minuten, lädt sich Ollama runter, zieht das Modell, deployt es — fer…