Lokale KI

Besten lokale KI Modele

Besten lokale KI Modele

Besten lokale KI Modele

1. Qwen3.8-27B 🇨🇳 – beste lokale KI insgesamt

* Alibaba / China * Sehr stark bei Deutsch, Englisch, Programmieren, Reasoning und allgemeinen Aufgaben. * Mit 27B Parametern noch realistisch auf einem starken Heim-PC. * Besonders interessant mit 24 GB VRAM oder viel Unified Memory. * Apache-2.0-Lizenz. Qwen hat die offiziellen Gewichte am 13. August 2026 veröffentlicht. * Meine Empfehlung für die meisten Nutzer.

2. Gemma 4 12B 🇺🇸 – beste Wahl für normale Hardware

* Google * Text + Bilder + Audio + Video. * Sehr gutes Verhältnis zwischen Qualität und Hardwarebedarf. * Google nennt bereits Systeme mit 16 GB RAM/VRAM als Zielklasse für lokale Nutzung. * Ideal für Laptop, Mini-PC oder kleinere GPU.

3. gpt-oss-20b 🇺🇸 – sehr gut für Reasoning

* OpenAI * 21B Parameter, davon nur etwa 3,6B gleichzeitig aktiv. * Dadurch vergleichsweise schnell. * Besonders gut für logisches Denken, Coding und Tool-Nutzung. * Apache 2.0 und ausdrücklich für lokale Consumer-Hardware gedacht.

4. DeepSeek V4 Flash 🇨🇳 – extrem leistungsfähig

* DeepSeek / China * 284B Gesamtparameter, aber nur etwa 13B aktiv. * 1 Million Tokens Kontext. * Besonders stark bei Coding, Reasoning und Agenten. * Die aktuelle V4-Flash-0731-Version ist nochmals verbessert worden. * Problem: Trotz nur 13B aktiver Parameter müssen die riesigen Modellgewichte gespeichert werden. Eher 128-GB-Workstation als normaler Gaming-PC.

5. Mistral Small 4 🇫🇷 – beste europäische Alternative

* Mistral AI / Frankreich * 119B MoE-Modell. * Text + Bilder. * Stark bei Chat, Reasoning, Coding und Agenten. * Interessant, wenn du bewusst eine europäische Alternative zu chinesischen und amerikanischen Modellen möchtest.

6. MiniMax M3 🇨🇳 – sehr stark multimodal

* MiniMax / China * 428B Parameter, ca. 23B aktiv. * 1 Million Tokens Kontext. * Kann Text, Bilder und Video verarbeiten. * Sehr interessant für lange Dokumente, Coding und multimodale Aufgaben. * Für normale PCs allerdings deutlich zu groß.

7. GLM-5.2 🇨🇳 – Topmodell für Coding und Agenten

* Z.ai / Zhipu AI / China * 744B Parameter, beim Vorgänger GLM-5 etwa 40B aktiv. * GLM-5.2 bietet 1 Million Tokens Kontext und konzentriert sich stark auf lange, komplexe Aufgaben. * Sehr leistungsfähig, aber Serverklasse.

8. Kimi K3 🇨🇳 – wahrscheinlich das spannendste chinesische Frontier-Modell

* Moonshot AI / China * gigantische 2,8 Billionen Parameter * native Bildverarbeitung * 1 Million Tokens Kontext * Open Weights. * Von der reinen Modellklasse extrem interessant, aber nicht sinnvoll auf einem normalen Heim-PC.

Welche würde ich nehmen?

8–12 GB VRAM / 16 GB RAM: → Gemma 4 12B in einer guten Quantisierung.

16 GB VRAM / 32 GB RAM: → Qwen3.8-27B quantisiert oder gpt-oss-20b.

24 GB VRAM, z. B. RTX 4090/5090: → Qwen3.8-27B wäre momentan meine erste Wahl.

Mac mit 64–128 GB Unified Memory: → Qwen3.8-27B problemlos und zunehmend größere MoE-Modelle werden interessant.

128 GB+ RAM / mehrere GPUs: → DeepSeek V4 Flash, größere Mistral-Varianten oder MiniMax.

Server mit sehr viel RAM/VRAM: → GLM-5.2 / Kimi K3 / DeepSeek V4 Pro.

Nur chinesische Modelle

🥇 Qwen3.8-27B – beste Wahl für einen normalen lokalen Rechner 🥈 DeepSeek V4 Flash – stärkere Klasse, aber enormer Speicherbedarf 🥉 MiniMax M3 – stark für multimodale Aufgaben GLM-5.2 – hervorragend für Coding/Agents Kimi K3 – extrem leistungsfähig, aber Hardwaremonster

Kurz gesagt

Für einen normalen leistungsfähigen PC würde ich aktuell Qwen3.8-27B nehmen.

Für weniger Hardware → Gemma 4 12B.

Wenn Hardware praktisch keine Rolle spielt → DeepSeek V4 / GLM-5.2 / Kimi K3 gehören zu den interessantesten chinesischen Open-Weight-Modellen.

Beitrag teilen

Facebook Instagram TikTok WhatsApp