VIBE CODING
// KATALOG

Modelle

KI-Modelle im Überblick — Stärken, Preise und Einsatzgebiete.

KI-Modelle im Vergleich: Dieser Katalog stellt die relevanten Sprachmodelle für Coding und Agent-Workflows vor — mit Stärken, Schwächen, Preisen und typischen Einsatzgebieten. Die drei Frontier-Familien Claude (Opus, Sonnet, Haiku), GPT / ChatGPT und Gemini decken die meisten Vibe-Coding-Szenarien ab.

Daneben lohnt der Blick auf Open-Weight-Alternativen: DeepSeek und Qwen Coder liefern starke Coding-Leistung zu einem Bruchteil der API-Kosten und lassen sich teils lokal betreiben. Jede Modellseite ordnet ein, wann sich der Wechsel lohnt und welches Modell zu welchem Budget und Projekt passt.

MODELLE3 min read// neu

Qwen 3.6-35B-A3B: Lokale Multimodale Agents ohne Zensur

Qwen3.6-35B-A3B Uncensored bietet Hermes V3 Fine-Tuning und Bildanalyse für lokale KI-Agenten. Ideal für GPU-Setups und komplexe Automatisierung im Jahr 2026.

QwenLocal-LLMMulti-Modal
MODELLE3 min read

Claude Fable 5 & Mythos 5: Anthropics Modellklasse über Opus

Claude Fable 5 ist Anthropics allgemein verfügbares Top-Modell der Mythos-Klasse. Der Steckbrief zeigt Preise, Sicherheitsmechanismen und die bewegte Freigabe-Historie 2026.

AnthropicClaude Fable 5Mythos 5
MODELLE3 min read

DeepSeek V4: 1-Million-Token-Kontext zum Kampfpreis

DeepSeek V4 ist die Open-Weights-Generation mit V4-Pro und V4-Flash, 1M-Token-Kontext und DSpark Speculative Decoding. Der Steckbrief zeigt Specs, Preise und Agenten-Kurs.

DeepSeekDeepSeek V4Open Source
MODELLE3 min read

Google Gemma 4 (12B/26B): Multimodales Open-Source-Modell fürs Notebook

Google Gemma 4 bringt multimodale KI mit Audio-Input unter Apache 2.0 auf lokale Hardware — mit QAT-Varianten und MTP-Speculative-Decoding bis 100+ Token/s.

Gemma 4GoogleLocal LLM
MODELLE3 min read

GPT-5.6 Sol: OpenAIs Flaggschiff mit sechs Reasoning-Leveln

GPT-5.6 Sol ist OpenAIs Top-Modell der Familie Sol, Terra und Luna. Der Steckbrief zeigt Reasoning-Level, Preise, den Release unter Regierungsvorbehalt und den Praxistest.

OpenAIGPT-5.6GPT-5.6 Sol
MODELLE3 min read

Grok 4.5 & Grok Build: xAIs Coding-KI plus Open-Source-Harness

Grok 4.5 ist xAIs erstes auf Coding und Agenten spezialisiertes Modell — Grok Build das zugehörige Open-Source-Harness unter Apache 2.0. Der Steckbrief.

Grok 4.5Grok BuildxAI
MODELLE3 min read

Kimi K3 & K2.7 Code: Moonshots 2,8-Billionen-Parameter-Angriff

Kimi K3 ist Moonshot AIs Flaggschiff mit 2,8 Billionen Parametern und 1M-Token-Kontext. Der Steckbrief zeigt Benchmarks, K2.7 Code, HighSpeed-Modus und Open-Weights-Termin.

Moonshot AIKimi K3Kimi K2.7 Code
MODELLE3 min read

MiniMax M3: Open-Weight-MoE mit 1M-Token-Kontext

MiniMax M3 ist ein Open-Weight-MoE-Modell (428B/23B aktiv) mit 1M-Token-Kontext und Sparse Attention — stark bei Coding- und Agenten-Benchmarks.

MiniMaxMiniMax M3MoE
MODELLE3 min read

NVIDIA Nemotron 3: Offene Modellfamilie von Nano Omni bis 550B Ultra

NVIDIA Nemotron 3 ist eine Open-Weight-Familie für Agenten: Nano Omni (multimodal), Ultra (550B Mamba2-Hybrid) und Embed (RAG-Retrieval). Der Steckbrief.

NVIDIANemotron 3Open-Weight
MODELLE4 min read

Qwen 3.6 / 3.7 (Plus, Max): Alibabas Agenten-Generation mit 1M-Kontext

Qwen 3.6 und 3.7 sind Alibabas aktuelle Modellgenerationen 2026: multimodal, agentic, 1M-Token-Kontext — plus Uncensored-Variante für lokale Nutzung.

QwenQwen 3.7Qwen 3.6
MODELLE3 min read

Soofi S 30B-A3B: Das offene MoE-Modell aus München

Soofi S 30B-A3B ist ein offenes MoE-Modell aus München, das Olmo 3 schlägt — trainiert auf deutscher Cloud-Infrastruktur, optimiert für Deutsch. Steckbrief.

Soofi SMoEOpen Source
MODELLE2 min read

Tencent Hy3: 295B-MoE-Modell für Coding und Agenten

Tencent Hy3 ist ein 295-Milliarden-Parameter-MoE-Modell von Hunyuan mit 256K-Kontext, optimiert für Coding, Reasoning und zuverlässiges Tool-Calling.

TencentHy3Hunyuan
MODELLE3 min read

Xiaomi MiMo-V2.5 & MiMo Code: 1-Billion-Parameter-MoE unter MIT-Lizenz

Xiaomi MiMo-V2.5 ist eine offene MoE-Modellfamilie (bis 1,02 Billionen Parameter, MIT-Lizenz) mit 1M-Kontext — plus MiMo Code als Open-Source-Coding-Agent.

XiaomiMiMo-V2.5MiMo Code
MODELLE2 min read

GLM-5.2 vs. Claude Opus 4.8: Open-Source schließt 2026 auf

Zhipu AI veröffentlicht GLM-5.2 unter MIT-Lizenz. Das Modell fordert Claude Opus 4.8 in Coding-Benchmarks heraus und bietet 1M Kontext für Profis im Jahr 2026.

GLM-5.2Zhipu AIClaude Opus
MODELLE2 min read

Google DiffusionGemma: 1000 Token/s durch Text-Diffusion 2026

Google DiffusionGemma revolutioniert 2026 die Textgenerierung. Erfahre alles über 1000 Token/s, MoE-Architektur und Apache 2.0 im exklusiven deutschen Guide.

GoogleDiffusionGemmaLLM
MODELLE2 min read

Ling-2.6-flash: Ant Group bricht 2026 das LLM-Token-Diktat

Ling-2.6-flash der Ant Group bietet 2026 maximale Effizienz. Das MoE-Modell spart Token-Kosten durch präzise Antworten und glänzt in Agenten-Benchmarks. Guide.

Ant GroupLing-2.6-flashLLM
MODELLE3 min read

GLM-5.1: Chinas vielversprechende Open-Weight-Alternative zu Claude Opus für Coder

Zhipu AIs GLM-5.1 Update bietet eine kostengünstige, leistungsstarke Open-Weight-Alternative zu Claude Opus, ideal für Coding-Aufgaben und Agenten-Prototyping.

KILLMCoding
MODELLE2 min read

Google stellt Gemini 3.1 Flash-Lite vor: Schneller, günstiger und für Hochlast-Szenarien optimiert

Google präsentiert Gemini 3.1 Flash-Lite, die schnellste und günstigste KI-Modellvariante der Gemini 3.1-Reihe, ideal für High-Scale-Anwendungen.

GoogleGeminiKI-Modell
MODELLE3 min read

Claude (Opus, Sonnet, Haiku)

Anthropics Claude-Familie gilt als eines der stärksten Coding-Modelle 2026 — hier erfährst du alles zu Tarifen, Stärken und Einsatz.

ClaudeAnthropicOpus
MODELLE2 min read

DeepSeek V3.x

DeepSeek ist der Preis-Leistungs-König unter den Coding-Modellen — starkes Reasoning zu einem Bruchteil der Kosten.

DeepSeekDeepSeek V3Coding
MODELLE3 min read

Gemini (2.5 Pro, 3 Pro)

Googles Gemini-Modelle punkten mit riesigen Kontexten, starkem Reasoning und nahtloser Workspace-Integration.

GeminiGoogleGemini Pro
MODELLE3 min read

GPT / ChatGPT (GPT-4.1, GPT-5.x, o-Modelle)

OpenAIs GPT-Familie ist der Klassiker unter den Coding-Modellen — riesiges Ökosystem, starke Tools und viele Tarife.

GPTChatGPTOpenAI
MODELLE2 min read

Grok (xAI)

Grok von xAI punktet mit riesigen Kontexten, Live-Daten über X und starken Coding-Varianten.

GrokxAIElon Musk
MODELLE2 min read

Kimi K2 (Moonshot AI)

Kimi K2 von Moonshot AI ist ein extrem günstiges Modell mit starkem Langtext- und Coding-Fokus.

KimiKimi K2Moonshot AI
MODELLE2 min read

Meta Llama 3.x / 4

Metas Llama ist die größte offene Modellfamilie — viele Größen, sehr günstige Preise und maximale Flexibilität.

LlamaMetaOpen Source
MODELLE2 min read

Mistral / Codestral / Devstral

Mistral AI aus Europa bietet dedizierte Code-Modelle wie Codestral und Devstral — günstig, leistungsfähig und EU-freundlich.

MistralCodestralDevstral
MODELLE2 min read

Qwen2.5 / Qwen3 Coder

Qwen Coder von Alibaba ist der führende Open-Source-Coder 2026 — teils besser als GPT-4 bei HumanEval und SWE-Bench.

QwenQwen CoderAlibaba