Coding Plan

Vergleiche AI Coding Abos

Vergleiche Coding-PläneCompare Coding Plans

Coding-Assistenten revolutionieren die Softwareentwicklung. Vergleiche Coding-Abos von Z.ai, Alibaba, Claude, MiniMax und vielen weiteren Anbietern, um das beste Preis-Leistungs-Angebot zu finden.Coding assistants are revolutionizing software development. Compare coding subscriptions from Z.ai, Alibaba, Claude, MiniMax and many more providers to find the best value for your money.

63
Anbieter
241+
LLM Modelle
225+
Coding Tools
$1400
Höchstpreis

AnbieterProviders

Wähle das richtige Abo für deinen AI-gestützten Entwickler-WorkflowChoose the right subscription for your AI-powered development workflow

Vergleich der Coding-Pläne

Wähle das richtige Abo für deinen AI-gestützten Entwickler-Workflow

MonatlichJährlichBis zu $400/Jahr sparen
Agnes AI

Agnes AI

Aktualisiert: 2026-09-30

SG
Starter
$2 Erster Monat
$4/Monat
$3/Monat jährlich
1.5K Anfragen/5h15.0K Anfragen/Woche
1.500 Anfragen/5h, 15.000/Woche, 4.000 Bilder/Tag, 500s Video/Tag. Erster Monat $2, Jahresabo $40
PlusBeliebt
$5 Erster Monat
$10/Monat
$8/Monat jährlich
7.5K Anfragen/5h75.0K Anfragen/Woche
7.500 Anfragen/5h, 75.000/Woche, 4.000 Bilder/Tag, 500s Video/Tag. Erster Monat $5, Jahresabo $100
Pro
$25 Erster Monat
$50/Monat
$42/Monat jährlich
30.0K Anfragen/5h300.0K Anfragen/Woche
30.000 Anfragen/5h, 300.000/Woche, 4.000 Bilder/Tag, 500s Video/Tag. Erster Monat $25, Jahresabo $500

LLM Modelle (8)

Agnes-2.5-FlashAgnes-2.5-ProAgnes-3.0-FlashAgnes-Image-2.0-FlashAgnes-Image-2.1-FlashAgnes-Image-2.5-FlashAgnes-Video-2.5Agnes-Video-2.5-Flash

Features

  • Full-Stack-Multimodal-KI
  • Text-, Bild-, Video-Generierung
  • OpenAI-kompatibles API
  • Bildverstehen
  • Vision-Modelle
  • Video-Modelle
  • 1000 RPM (Token Plan)

Hinweise

  • • Text-Quoten: Starter 1.500 Anfragen/5h, Plus 7.500 Anfragen/5h, Pro 30.000 Anfragen/5h
  • • Bild-Quota: 4.000 Bilder/Tag (alle Pläne)
  • • Video-Quota: 500 Sekunden/Tag (alle Pläne)
  • • Token Plan Nutzer erhalten 1000 RPM für Textmodelle (vs. 10 RPM kostenlos, 20 RPM Enterprise — kostenloses Limit halbiert am 23.09.2026)
  • • Token Plan Bild-RPM: 100 (1K), 80 (2K); Video-RPM: 5
  • • Aktuell kostenlos: agnes-2.5-flash, agnes-3.0-flash Text; agnes-image-2.0/2.1/2.5-flash; agnes-video-2.5-flash (zeitlich begrenzt)
  • • Nutzt Agnes-3.0-Flash (~100 TPS, 150 TPS Off-Peak)
  • • Kompatibel mit gängigen Coding-Tools
  • • Monatliche Preise zeigen reguläre Raten
  • • Jahresabrechnung: Starter $40/Jahr, Plus $100/Jahr, Pro $500/Jahr (2 Monate gratis, Listenpreis $48/$120/$600)
  • • Erster Monat 50% Rabatt: Starter $2, Plus $5, Pro $25
  • • Pay-per-Token-Preise ebenfalls ohne Abo verfügbar
  • • Separate Pay-per-Token-Modelle (nicht im Token Plan): agnes-2.5-pro 0,45$/M Input, 0,90$/M Output, 0,045$/M Cache-Input
  • • Agnes 2.5 Pro ist GA (die frühere agnes-2.5-pro-beta ist jetzt die kommerzielle stabile Version)
  • • Bild-Listenpreise (aktuell 0$): 10$ pro 1.000 Bilder bei 1K, 18$ bei 2K, 21$ bei 3K, 24$ bei 4K; 4. und weitere Eingabereferenzbilder je 0,003$ (erste 3 gratis)
  • • agnes-video-2.5 ist nicht kostenlos: 0,025$/s (720P), 0,040$/s (1080P/1K), 0,055$/s (2K) — Listen- und aktueller Preis identisch, 6. und folgende Eingabebilder je 0,005$ (erste 5 gratis)
  • • Neues Agnes-3.0-Flash-Textmodell (512K Kontext, Thinking-Modus): Listenpreis 0,05$/M Input, 0,15$/M Output — aktuell kostenlos
  • • agnes-3.0-pro angekündigt ("coming soon", 0,45$/M Input, 0,90$/M Output, 0,045$/M Cache-Input) — noch nicht verfügbar und nicht Teil der Token-Plan-Quoten
  • • OpenAI-kompatibles API; Text-/Bild-/Video-Modelle von SapiensAI
  • • Quoten, RPM-Limits und Modellpreise am 05.10.2026 erneut gegen wiki.agnes-ai.com/en/docs/tokenplan und /pricing geprüft — unverändert seit 30.09.2026 (Starter 1.500/5h + 15.000/Woche, Plus 7.500/5h + 75.000/Woche, Pro 30.000/5h + 300.000/Woche, 1.000 RPM Text, 100/80 RPM Bild, 5 RPM Video)
  • • Planpreise (Starter 4$ / Plus 10$ / Pro 50$ monatlich, 40$/100$/500$ jährlich, erster Monat 50% Rabatt) konnten NICHT erneut geprüft werden: platform.agnes-ai.com/subscribe/subscription leitet weiterhin auf /login um (Headless-Render bestätigt, es feuert nur der unauthentifizierte Aufruf /api/user/subscription), Werte stammen vom 30.09.2026
Alaya NeW

Alaya NeW

Aktualisiert: 2026-10-05

CN
TokenPlan-Lite
$28/Monat
199¥/Monat (~28$). Ausverkauft (Landingpage Sep 2026) — leichte tägliche Nutzung, Schreiben/Lernen, leichtes Coding für private Projekte
TokenPlan-Plus
$56/Monat
399¥/Monat (~56$). Ausverkauft (Landingpage Sep 2026) — intensive tägliche Nutzung, Batch-Texte, lange Dokumente, Coding mittelgroßer Projekte
TokenPlan-Max
$98/Monat
699¥/Monat (~98$). Ausverkauft (Landingpage Sep 2026) — Team-Zusammenarbeit & Enterprise-Aufgaben, Wissensdatenbank, Agent-Automation, große Repos
Enterprise Lite
$420/Monat
2.999¥/Monat (~420$). 15% Erstmonats-Bonus (bis 450¥), ab dem 2. Monat 5%. Bis ~2,984 Mrd. Tokens/Monat
Enterprise StandardBeliebt
$560/Monat
3.999¥/Monat (~560$). 20% Erstmonats-Bonus (bis 800¥), ab dem 2. Monat 10%. Bis ~3,979 Mrd. Tokens/Monat
Enterprise Professional
$1400/Monat
9.999¥/Monat (~1.400$). 50% Erstmonats-Bonus (bis 5.000¥), ab dem 2. Monat 20%. Bis ~9,950 Mrd. Tokens/Monat
Enterprise Custom
Siehe Anbieter
Vertriebskontakt für individuelles Token-Volumen und Preise

LLM Modelle (3)

GLM-5.3GLM-5.2DeepSeek-V4-Flash

Features

  • Abrechnung nach Modell-Einheitspreis (Pay-per-use innerhalb des Abos)
  • OpenAI + Anthropic Dual-SDK-Kompatibilität
  • Bündelt GLM, DeepSeek und mehr LLMs — kein Lock-in
  • GLM-5.3 (neues Flaggschiff), GLM-5.2 und DeepSeek-V4 Flash (1M Kontext, tiefes Reasoning)
  • Enterprise-Token-Pläne (2.999¥/3.999¥/9.999¥/Monat); persönliche Pläne 199¥/399¥/699¥ gelistet, aber ausverkauft (Sep 2026)
  • Pioneer-Programm: kostenloser Test des 9.999¥/Monat-Plans
  • Basiert auf DataCanvas Alaya NeW Compute-Plattform

Hinweise

  • • Umbenannt zu "Alaya Token" (vorher Alaya NeW / AlayaCode)
  • • Persönliche Token-Pläne (199¥/399¥/699¥) auf der Landingpage ausverkauft (Okt 2026) — Preise angezeigt, kein Kauf möglich; Enterprise-Token-Pläne sind das gelistete Angebot und laufen über "Sign up for early access"
  • • Enterprise-Token-Pläne: Lite 2.999¥ (15% Erstmonats-Bonus bis 450¥, danach 5%), Standard 3.999¥ (20% bis 800¥, danach 10%), Professional 9.999¥ (50% bis 5.000¥, danach 20%), Custom (Sales)
  • • Pioneer-Programm (Datacanvas "Flagship Case Program"): online registrieren, freigeben lassen und dann kostenlosen Test des 9.999¥/Monat-Plans im Wert von bis zu 9.999¥/Monat mit review-basiertem Kontingent erhalten; ausgewählte Unternehmen bauen gemeinsam Industry-Benchmarks
  • • Echtzeit-Abrechnung nach Modell-Einheitspreis (Pay-per-use); OpenAI-kompatibler Endpunkt, eine Zeile Konfiguration
  • • Modelle: GLM-5.3 (neues Open-Source-Flaggschiff, stark verbesserte Coding-Fähigkeit), GLM-5.2 (Flaggschiff für die Long-Task-Ära), DeepSeek-V4 Flash (1M Kontext, verbessertes Planning/Mathematik/Code)
  • • Endpunkt (OpenAI): https://codingplan.alayanew.com/v1
  • • Endpunkt (Anthropic): https://codingplan.alayanew.com/anthropic
  • • Anbieter: 九章云极 DataCanvas (chinesisches KI-Infrastruktur-Unternehmen)
  • • API-Key nach Registrierung auf codingplan.alayanew.com
  • • Doku-Abrechnungsseite (docs.alayanew.com) beschreibt AlayaCode-Stufen Free/Pro/Team/Enterprise mit Token-Quotas und nur in der Konsole sichtbaren Preisen: Free 1M Tokens/Monat (60 RPM/30K TPM, minimax-m2.1 + glm-5 gedrosselt), Pro 30M (+minimax-m2.5, glm-5.1), Team 200M (+deepseek-v4-pro, 1M Kontext), Enterprise individuell; Drosselung nach Quota-Verbrauch (100K-Throttle-Pool/Tag, RPM auf 60, TPM auf 30K); quota_used = (Input+Output-Tokens) × Modellfaktor (minimax-m2.5 1.0, minimax-m2.1 0.6, glm-5 1.0, glm-5.1 1.2, deepseek-v4-pro 2.0)
  • • Landingpage (1. Okt 2026) verkauft Alaya-Token-Enterprise-Pläne (CTA "Sign up for early access") und listet Persönliche Pläne 199¥/399¥/699¥ als ausverkauft; Modell-Lineup ist GLM-5.3 / GLM-5.2 / DeepSeek-V4 Flash (Kimi K3 nicht mehr gelistet); unterstützte Tools: OpenClaw, Claude Code, Codex, OpenCode
Alibaba / Qwen

Alibaba / Qwen

Aktualisiert: 2026-10-05

CN
LiteEingestellt
Siehe Anbieter
Eingestellt am 20. März 2026. Keine Verlängerungen/Upgrades ab 13. April 2026
ProBeliebt
$50/Monat
6.0K Anfragen/5h45.0K Anfragen/Woche90.0K Anfragen/Monat
Einfache Aufgaben: typischerweise 5-10 Modell-Aufrufe pro Abfrage, komplexe 10-30 oder mehr

LLM Modelle (10)

Qwen3.7-PlusQwen3.6-PlusQwen3.5-PlusQwen3-Max-2026-01-23Qwen3-Coder-NextQwen3-Coder-PlusKimi-K2.5GLM-5GLM-4.7MiniMax-M2.5

Features

  • Mehrere Modellanbieter
  • Vision-Unterstützung
  • 1M Kontext bei qwen3.6-plus
  • OpenAI-kompatibler Endpunkt
  • Anthropic-kompatibler Endpunkt

Hinweise

  • • Jede Abfrage verbraucht Quota nach Anzahl der Modell-Aufrufe: einfache Aufgaben typischerweise 5-10 Aufrufe, komplexe 10-30 oder mehr (keine feste Anzahl pro Abfrage)
  • • 5-Stunden-Quota mit gleitendem Fenster (Zurücksetzen 5h nach Nutzung, minütlicher Rollover)
  • • Wöchentliche Quota wird montags 00:00 UTC+8 zurückgesetzt
  • • Monatliche Quota wird am Verlängerungsdatum des Abos zurückgesetzt
  • • Die drei Limits gelten gleichzeitig als Obergrenzen; das zuerst erreichte pausiert Aufrufe
  • • API-Schlüsselformat: sk-sp-xxx
  • • Verboten: API-Aufrufe für automatisierte Skripte, Anwendungs-Backends oder nicht-interaktive Szenarien
  • • Zwei Regionen: Global/Intl (bailian.console.alibabacloud.com, OpenAI-Endpunkt coding-intl.dashscope.aliyuncs.com/v1, Anthropic-Endpunkt coding-intl.dashscope.aliyuncs.com/apps/anthropic, kein +86) und China (bailian.console.aliyun.com, erfordert +86)
Amazon Q Developer

Amazon Q Developer

Aktualisiert: 2026-10-04

US
Free
$0/Monat
50 Anfragen/Monat
50 Agentic-Anfragen/Monat, neueste Claude-Modelle, IDE & CLI-Zugang, 1.000 LOC/Monat Java-Transformation
ProBeliebt
$19/Monat
19$/Benutzer/Monat. Höhere Agentic-Limits, 4.000 LOC/Monat gepoolte Java- + 1M LOC/Monat .NET-Transformation, IP-Schadloshaltung, Identity-Center-Admin, Admin-Dashboard

LLM Modelle (4)

Claude Sonnet 4.6Claude Sonnet 4.5Claude Opus 4.6Claude Opus 4.5

Features

  • Neueste Claude-Modelle
  • Agentic-Coding in IDE und CLI
  • Java/.NET Code-Transformation
  • IP-Schadloshaltung (Pro)
  • Referenz-Tracking
  • Code-Unterdrückung
  • Identity-Center-Integration

Hinweise

  • • Free (50 Agentic-Anfragen/Monat, Claude-Modelle), Pro 19$/Benutzer/Monat (erhöhte Limits, IP-Schadloshaltung)
  • • Pro: 4.000 LOC/Monat gepoolte Java-Transformation (Überschreitung 0,003$/LOC) + 1M LOC/Monat .NET (10 parallele Jobs); Identity-Center-Admin, Dashboard & Controls
  • • Pro-Kontingente (pro Benutzer): Agentic-Anfragen 1.000/Monat, Generative SQL 1.000 Abfragen/Monat, Netzwerk-Reichweitenanalyse 20 Anfragen/Tag, CodeCatalyst-Agent 30/Monat + 20 PR-Zusammenfassungen/Monat
  • • Am 04.10.2026 erneut geprüft gegen aws.amazon.com/q/developer/pricing und docs.aws.amazon.com/amazonq/latest/qdeveloper-ug/quotas.html — Free 50 Agentic-Anfragen/Monat, Pro 19$/Benutzer/Monat, Java 1.000/4.000 LOC, alle Kontingente unverändert
  • • .NET-Transformation: Pro-Abo 1.000.000 LOC pro unterstützter Region mit 10 parallelen Jobs; Builder-ID-Free-Tier 1.000 LOC pro Region mit 1 parallelen Job
  • • AWS stellt den Support für Amazon-Q-Developer-IDE-Plugins am 30.04.2027 ein — Free/Pro-Tarife bleiben verkäuflich, AWS empfiehlt Kiro für IDE-Plugin-Workloads
Atlas Cloud

Atlas Cloud

Aktualisiert: 2026-10-05

US
Starter
$10/Monat
Perfekt für Einzelentwickler zum Einstieg, mit zuverlässigem Tageskontingent
Lite
$20/Monat
Ideal für tägliches Coding und kleine Projekte — bestes Preis-Leistungs-Verhältnis
PlusBeliebt
$50/Monat
Der Sweet Spot zwischen Leistung und Kosten — ideal für mittelgroße Projekte
Max
$100/Monat
Für anspruchsvollere Workflows und kleine Team-Zusammenarbeit
Ultra
$200/Monat
Für Power-User mit lang laufenden, Multi-Task-Workflows
Enterprise
$500/Monat
Enterprise-Tarif mit SLA und individuellen Optionen
Pack Small
$99/Monat
Pay-per-Use-Pack: 280M Gesamtpunkte, 90 Tage gültig. Stackbar mit Monatsplänen
Pack Medium
$299/Monat
Pay-per-Use-Pack: 850M Gesamtpunkte, 90 Tage gültig. Stackbar mit Monatsplänen
Pack Large
$599/Monat
Pay-per-Use-Pack: 1,7Mrd. Gesamtpunkte, 90 Tage gültig. Stackbar mit Monatsplänen

LLM Modelle (18)

DeepSeek-V4-ProDeepSeek-V4-Pro-0813DeepSeek-V4-FlashDeepSeek-V4-Flash-0731DeepSeek-V3.2Kimi-K2.7-CodeKimi-K2.6Kimi-K2.5GLM-5.2GLM-5.1GLM-5MiniMax-M3MiniMax-M2.7MiniMax-M2.5Qwen3.8-MaxQwen3.6-PlusDoubao-Seed-2.1-ProDoubao-Seed-2.1-Turbo

Features

  • Punktebasiertes Quota-System
  • 35-50% günstiger als Pay-per-Use
  • 35% günstiger als OpenRouter
  • Dedizierter Coding-Plan API-Key (separater Scope)
  • Ausschließlich SOTA Open-Source-Modelle
  • Wöchentliche Obergrenze wird Montag 00:00 UTC zurückgesetzt
  • Pay-per-Use Overflow-Packs (90 Tage)
  • OpenAI & Anthropic kompatible Endpunkte

Hinweise

  • • Punkte = Input-Tokens × Input-Multiplikator + Output-Tokens × Output-Multiplikator
  • • Multiplikatoren variieren pro Modell (siehe Coding-Plan-Seite); z.B. GLM-5.2: 20% Rabatt, Doubao Seed 2.1 Pro/Turbo: 20% Rabatt, Qwen3.8-Max: 40% Rabatt, Qwen3.6-Plus: 50% Rabatt, DeepSeek V4 Pro: 50% Rabatt, Kimi K2.7-Code/K2.6/K2.5: 45% Rabatt, GLM-5/5.1: 45% Rabatt, MiniMax M2.5/M2.7: 45% Rabatt, MiniMax M3 & DeepSeek V3.2: 55% Rabatt
  • • Unterstützte Modelle: DeepSeek V4 Pro/Pro-0813/Flash/Flash-0731/V3.2, Kimi K2.5/K2.6/K2.7-Code, GLM 5/5.1/5.2, MiniMax M2.5/M2.7/M3, Qwen3.6 Plus/Qwen3.8 Max, Doubao Seed 2.1 Pro/Turbo (18 Modelle)
  • • Dual-Limit-System: wöchentliche Obergrenze + monatliches Gesamtlimit. Wöchentliche Obergrenze wird Montag 00:00 UTC zurückgesetzt (keine Übertragung); Monatsgesamt steht den ganzen Zyklus zur Verfügung, wird bei Verlängerung zurückgesetzt
  • • Nach Erschöpfung des Wochenkontingents werden Pay-per-Use-Packs automatisch verbraucht (falls vorhanden); sonst pausiert die Nutzung bis zum nächsten wöchentlichen Reset
  • • Coding-Plan API-Keys sind auf Plan-Modelle beschränkt — separater Key für Pay-per-Use nötig
  • • Pay-per-Use-Packs: Small 99$/280M, Medium 299$/850M, Large 599$/1,7Mrd. Punkte, 90 Tage gültig
  • • Abrechnungszeitraum: 30 Tage. Aktuell keine Jahresabrechnung verfügbar
Augment Code

Augment Code

Aktualisiert: 2026-10-05

US
FreeEingestellt
$0/Monat
0$ — einmalige 20$ Credit-Gutschrift, keine Kreditkarte erforderlich. Bis zu 50 Sitze (Cosmos, CLI, Context Engine, MCP & Native Tools). Wird nicht mehr auf der Preisseite und in der Doku gelistet (Okt 2026)
Standard
$20/Monat
20$/Monat pauschal — bis zu 50 Sitze. 20$/Monat Nutzung inkludiert. Context Engine, Cosmos, CLI, MCP & Native Tools
BusinessBeliebt
$100/Monat
100$/Monat pauschal — bis zu 50 Sitze. 100$/Monat Nutzung inkludiert. Context Engine, Cosmos, CLI, MCP & Native Tools
Enterprise
Siehe Anbieter
Individuelle Nutzerpreise, maßgeschneiderte Nutzungslimits. Volumenbasierte Jahresrabatte, SSO, OIDC, SCIM, CMEK, ISO 42001, dedizierter Support

LLM Modelle (27)

Claude Fable 5.1Claude Fable 5Claude Opus 5Claude Opus 4.8Claude Opus 4.7Claude Opus 4.6Claude-Sonnet-5.5Claude Sonnet 5Claude Sonnet 4.6Claude Haiku 4.5Gemini-3.8-FlashGemini-3.7-FlashGemini-3.1-ProGLM-5.3-FlashGLM-5.2GPT-6-AstraGPT-6.1-SolGPT-5.6-SolGPT-5.6-TerraGPT-5.6-LunaGPT-5.5Grok-4.6Grok-4.5Kimi-K3Kimi-K2.7-CodePrism (Claude + Gemini)Prism (GPT)

Features

  • Context Engine
  • Coding-Agent
  • Chat & Agents
  • CLI-Zugriff
  • MCP & Native Tools
  • Cosmos
  • 40% Servicegebühr auf LLM-Nutzung
  • Kein KI-Training erlaubt
  • Code Review
  • Nutzungsanalysen
  • SOC 2 Type II

Hinweise

  • • Free-Plan: 0$/Monat, einmalige 20$ Credit-Gutschrift (keine Kreditkarte erforderlich), bis zu 50 Sitze
  • • Standard-Plan: 20$/Monat pauschal, 20$ Nutzung inkludiert (LLM, Compute & Servicegebühr), bis zu 50 Sitze
  • • Business-Plan: 100$/Monat pauschal, 100$ Nutzung inkludiert (LLM, Compute & Servicegebühr), bis zu 50 Sitze
  • • LLM wird zu den öffentlichen API-Listenpreisen des Anbieters abgerechnet, plus 40% Servicegebühr auf LLM-Nutzung (keine Gebühr auf Compute)
  • • Cosmos-Compute 0,19$/Stunde, abgerechnet in 5-Minuten-Schritten; Nachkäufe Pay-as-you-go zu denselben Raten
  • • Optionale Aktivitäten mit Verbrauch aus dem Kontingent: Prompt Enhancer, Code Review (automatisches PR-Review, wenn für das Repo aktiviert), Skills; aktuelle Raten pro Modell und Nutzungsaufschlüsselung nach Modell, Aktivität und Komponente im Dashboard (Usage → Models)
  • • Nutzung und Nachkäufe werden im gesamten Team gepoolt — keine Pro-Sitz-Gebühr; Nachkäufe 12 Monate gültig
  • • Modelle (Doku): Claude Fable 5.1 / 5, Opus 5 / 4.8 / 4.7 / 4.6, Sonnet 5.5 / 5 / 4.6, Haiku 4.5; Gemini 3.8 Flash / 3.7 Flash / 3.1 Pro; GLM 5.3 Flash / 5.2; GPT-6 Astra, GPT-6.1 Sol, GPT-5.6 Sol / Terra / Luna, GPT-5.5; Grok 4.6 / 4.5; Kimi K3 / K2.7 Code; Prism (Claude + Gemini), Prism (GPT)
  • • GPT-6.1 Sol ersetzt GPT-6 Sol in berechtigten Workspaces, die zuvor GPT-6 Sol angeboten haben; Sonnet 5 und GPT-6 Sol bleiben unter "More" verfügbar, wo die neuere Variante angeboten wird
  • • Token-Raten pro Modell (Doku, USD pro MTok, Eingabe/Ausgabe): Fable 5.1 10/50, Fable 5 10/50, Opus 5 5/25, Opus 4.8/4.7/4.6 5/25, Sonnet 5.5/5 2/10, Sonnet 4.6 3/15, Haiku 4.5 1/5; Gemini 3.8/3.7 Flash 0,75/3,75, Gemini 3.1 Pro 2/12; GLM 5.3 Flash 0,15/0,50, GLM 5.2 1,40/4,40; GPT-6 Astra 10/50, GPT-6.1 Sol 2/10, GPT-5.6 Sol 4/20, Terra 2/12, Luna 0,20/1,20, GPT-5.5 5/30; Grok 4.6/4.5 2/6; Kimi K3 3/15, Kimi K2.7 Code 0,95/4
  • • Prism (Claude + Gemini) routet zwischen Claude Opus 5, Claude Sonnet 5 und Gemini 3.0 Flash; Prism (GPT) routet zwischen GPT-5.6 Sol, GPT-5.6 Luna und einer GPT-5.6-Luna-Solver-Stufe (die Preis-Doku nennt die erste Option "Prism (Claude + GPT)")
  • • Prism kostet im Schnitt 20-30% weniger als Frontier-Modelle bei minimalem Qualitätsverlust
  • • Enterprise: unbegrenzte Nutzer, unbegrenzte parallele Sessions, Multi-Region-Compute, individuelle Nachkäufe
  • • Enterprise: individuelle Nutzerpreise, maßgeschneiderte Nutzungslimits, SSO, OIDC, SCIM, CMEK & ISO 42001
  • • Die Preisseite listet aktuell nur Standard, Business und Enterprise — kein separater Free-Plan gelistet (Okt 2026; der Free-Tier fehlt auch in der Doku)
Baidu Qianfan

Baidu Qianfan

Aktualisiert: 2026-10-05

CN
Mini
$0.73 Erster Monat
$1.48/Monat
10M Tokens, leichte Nutzung, Testversion
Lite
$2.97 Erster Monat
$6/Monat
$5/Monat jährlich
42M Tokens, 5h- und 7-Tage-Punktelimits derzeit aufgehoben
ProBeliebt
$14.91 Erster Monat
$29/Monat
$23/Monat jährlich
230M Tokens, 5h- und 7-Tage-Punktelimits derzeit aufgehoben
Max
$44.76 Erster Monat
$86/Monat
700M Tokens, schwere Nutzung, Agent-Workflows

LLM Modelle (8)

DeepSeek-V4.1-FlashDeepSeek-V4-ProDeepSeek-V4-Pro-0813DeepSeek-V4-Flash-0731GLM-5.3GLM-5.3-FlashGLM-5.2GLM-5.1

Features

  • Multi-Provider-Modellzugang
  • Prompt-Caching-Unterstützung
  • Hoher Durchsatz
  • Sicherheit auf Unternehmensniveau

Hinweise

  • • Token Plan: Mini ¥9,9, Lite ¥40, Pro ¥200, Max ¥600 (50% Einführungsrabatt beim ersten Kauf)
  • • Neue Punkte-basierte Abrechnung (积分制) zusätzlich zur Token-Abrechnung; Monatskontingent wird jetzt auch in Punkten angezeigt (Mini 1.400 / Lite 6.600 / Pro 45.000 / Max 165.000)
  • • Coding Plan alle Tarife seit 13. Juli 2026 für Neukäufe eingestellt — ersetzt durch Token Plan 个人版 (bestehende Pläne laufen weiter; 1-Klick-Migration verlängert Gültigkeit um 1 Monat)
  • • National-Day-Aktion (24. Sep – 7. Okt 2026): limitierte Aufladepakete und Tarife mit 28.000 Punkten für ¥49,9 bzw. 88.000 Punkten für ¥99,9, keine Verlängerung/Autoverlängerung/Upgrades, Ablauf immer am 7. Okt 2026; Abrechnungsreihenfolge Aktionspaket > Aktions-Aufladepaket > Standardpaket > Standard-Aufladepaket, Aufladepakete erfordern ein aktives Abo
  • • Zweite Aktion: ausgewählte Modelle in Idle-Zeiten bis zu 50% günstiger (0.5折)
  • • Aktion: Erster Kauf 50% Rabatt (Neu-Kunden ab ¥4,9), Verlängerung 60% Rabatt (6折); ganztägiger Gradienten-Rabatt: werktags tagsüber 2折, nachts bis 0,5折, Wochenende 1折; Kontingent bis zu 20x verstärkt auf GLM-5.2 und DeepSeek-V4-Pro-0813
  • • Kontingent gültig für 1 Monat ab Aktivierung
  • • Modelle: DeepSeek-V4.1-Flash, DeepSeek-V4-Pro (-0813), DeepSeek-V4-Flash-0731, GLM-5.3, GLM-5.3-Flash, GLM-5.2, GLM-5.1
  • • deepseek-v4-flash (Preview) und kimi-k2.6 werden laut Token-Plan-Doku am 29. Sep 2026 abgeschaltet
  • • Lite: 42M Tokens, Pro: 230M Tokens, Max: 700M Tokens
  • • Punktebasierte Abrechnung: 5-Stunden- und 7-Tage-Punkte-Limits sind derzeit für alle Tarife aufgehoben
  • • Migration von Token制 zu 积分制 möglich (nicht umgekehrt); der verbleibende Token-Rest wird anteilig in Punkte umgerechnet
  • • Punkte-Beispiel DeepSeek-V4-Pro: ca. 3 Punkte pro 11.520 Tokens (Input 853 / Cache 10.240 / Output 427)
  • • Eigener API-Key und eigene Base URLs: OpenAI-kompatibel qianfan.baidubce.com/v2/tokenplan/personal, Anthropic-kompatibel qianfan.baidubce.com/anthropic/tokenplan/personal
  • • Modell entweder per model-Parameter oder über den Alias qianfan-code-latest wählen
  • • Paket-Upgrades jederzeit möglich (sofort wirksam, Ablaufdatum bleibt, kein Downgrade); keine Erstattung
  • • Ein Token Plan 个人版 pro Baidu-Konto; bestehende Coding-Plan-Abonnenten wechseln kostenlos in denselben Tarif
  • • Nur interaktive Nutzung in Coding-/Agent-Tools — nicht für automatisierte Skripte oder App-Backends
  • • Einheitlicher Token-Pool — kein Modell-Multiplikator, keine Input/Output-Aufteilung
  • • Kompatibel mit Cursor, Windsurf, Cline, OpenAI/Anthropic-Protokollen
  • • Registrierung erfordert wahrscheinlich eine chinesische Festland-Rufnummer (+86)
Blackbox AI

Blackbox AI

Aktualisiert: 2026-10-05

US
Pay-As-You-GoEingestellt
$0/Monat
Eingestellt (Sep 2026). Mess-Prepaid-Credits, Tarif pro Token. Nicht mehr auf der Preisseite
EnterpriseBeliebt
Siehe Anbieter
Individuell. Dedizierter FDE, BYOK, SAML SSO/SCIM/RBAC, Single-Tenant-Deployment, garantierte TPM

LLM Modelle (7)

Kimi-K3GLM-5.3DeepSeek-V4-Pro-0813Qwen3.8-MaxDeepSeek-V4.1-FlashHy4-previewNemotron-3-Ultra

Features

  • 300+ KI-Modelle in einer Plattform
  • Pay-as-you-go-Mess-Abrechnung
  • BYOK (eigener API-Key) nur auf Enterprise
  • Multi-Agent-Workflow
  • Figma-zu-Code-Konvertierung
  • Voice- & Screen-Share-Agents
  • App Builder (Vibe Coding)
  • Remote Agent für Async-Aufgaben
  • Enterprise: SAML SSO/SCIM/RBAC
  • Enterprise: dediziertes Single-Tenant-Deployment
  • Enterprise: garantierte TPM

Hinweise

  • • Preisseite am 05.10.2026 erneut verifiziert — weiterhin Enterprise-/Commit-first, „Priced per token, committed once": 01 Enterprise (Jahres-PO-Burn-down, Vertrag auf Basis der Rack-Raten, Rabatt steigt mit Committed Spend; Closed −5%+, Open −10%+), 02 Vergleich, 03 Preise je Modell. Kein Consumer-/PAYG-Tier gelistet — das Commitment (jährliche Enterprise-Ausgabe) ist die einzige Variable. Keine Plattformgebühren, keine Pro-Seat-Kosten, Abrechnung pro Token. Commits sind so dimensioniert, dass ein Director oder VP ohne Freigabekette unterschreiben kann; intelligentes Routing und Prompt-Caching verlängern dasselbe Commit um 10–20%, auch bei geschlossenen Modellen. Nicht verbrauchtes Commitment verfällt am Ende der Abrechnungsperiode, Warnungen bei 75% und 90%. Die Tiers Free/Pro/Pro Plus/Pro Max sowie der Self-Serve-Pay-As-You-Go-Tarif bleiben eingestellt. Oberflächen: Enterprise Inference (Open-Weight-Modell auf reservierter Kapazität, keine geteilten Pools), Blackbox Router (300+ offene und geschlossene Modelle über einen Endpunkt mit ZDR und No-Training-Durchsetzung), Agents API (Cloud-Coding-Agents über HTTP, Multi-Agent + Chairman-LLM-Orchestrierung, gemessen), CLI (agentischer Terminal). Änderung ggü. 03.10. betrifft den Fetch, nicht die Daten: diesmal rendert im einfachen Text-Fetch nur die FAQ-Hälfte der Seite, die Blöcke 01/02/03 mit der Ratentabelle fehlen also wieder und der Enterprise-Eintrag bleibt zuletzt verifiziert; der FAQ-Inhalt selbst ist unverändert (Commit-Mechanik, keine Plattformgebühr und keine Pro-Seat-Kosten, BYOK, nicht verbrauchtes Commitment verfällt am Periodenende mit Warnungen bei 75% und 90%, der FDE schreibt Code in eurem Stack und ist auf Enterprise ohne Aufpreis enthalten, und „wann muss ich mit dem Vertrieb sprechen? Von Anfang an"). Am 03.10. war die Ratentabelle noch im einfachen Text-Fetch enthalten, ein Headless Browser war damals also nicht nötig. Neuester Blog-Eintrag ist jetzt der 29.09.2026 („Set the Target. Agents Tune the Engine Until They Hit It.") vor Nemotron 3.5 Lightning (11.08.2026) und dem TB-v2.1-Blackbox-Benchmark (21.07.2026). Nemotron 3 Ultra bleibt laut Artificial Analysis der #1-Speed-Provider (454 Tok/s, Juli 2026) mit 0,44$ Cache-Input pro 1M und 0,44$ geblendet pro 1M — 2,7x günstiger als der #2 schnellste Provider. Firmierenanschrift 535 Mission Street, San Francisco, CA.
  • • Preise pro Modell am 03.10.2026 erneut verifiziert (je 1M Tokens, Eingabe/Ausgabe/Cache; alle sechs Modelle unverändert): Kimi-K3 3,00$/15,00$/0,30$, GLM-5.3 1,40$/4,40$/0,14$, Qwen3.8-Max 2,00$/6,00$/0,25$ (262K Kontext), DeepSeek-V4.1-Flash 0,30$/1,20$/0,007$, DeepSeek-V4-Pro-0813 0,66$/1,98$/0,07$, Hy4-preview 0,83$/2,50$/0,04$
  • • BYOK nur auf Enterprise: keine Plattformgebühren, keine Aufschläge, Abrechnung über eigene Provider-Konten (OpenAI, Anthropic, Google); Routing, Failover, Caching und Dashboard bleiben verfügbar. Firmierenanschrift jetzt 535 Mission Street, San Francisco, CA
BytePlus ModelArk

BytePlus ModelArk

Aktualisiert: 2026-10-05

SG
Lite
$10/Monat
$10/Monat jährlich
1.9K Anfragen/5h12.0K Anfragen/Woche24.0K Anfragen/Monat
10$/Monat. 3× Claude Pro Nutzung. Vierteljährlich: 30$/Quartal (120$/Jahr). 5-Stunden gleitendes Fenster
ProBeliebt
$50/Monat
$50/Monat jährlich
9.5K Anfragen/5h60.0K Anfragen/Woche120.0K Anfragen/Monat
50$/Monat. Vierteljährlich: 150$/Quartal (600$/Jahr). 5× Lite-Nutzung (3× Claude Max)

LLM Modelle (12)

Dola-Seed-2.0-ProDola-Seed-2.0-LiteDola-Seed-2.0-CodeByteDance-Seed-CodeDeepSeek-V4-ProDeepSeek-V4.1-FlashDeepSeek-V4-FlashGLM-5.2GLM-5.3-FlashGLM-5.1Kimi-K2.5GPT-OSS-120B

Features

  • ByteDance-native Zusammenarbeit
  • ArkClaw-Cloud-Agent inklusive mit Pro
  • Mehrere Modelle (Dola-Seed, GLM, Kimi, GPT-OSS, DeepSeek)
  • Sicheres privates Hosting
  • Auto-Modus (wählt optimales Modell)

Hinweise

  • • Coding Plan Lite/Pro mit Seed, GLM, Kimi, DeepSeek, GPT-OSS Modellen
  • • ArkClaw-Cloud-Agent inklusive mit Pro (dedizierte ECS-VM, 24/7); Lite ohne ArkClaw seit 24. März 2026
  • • Quota basiert auf Anfrageanzahl, nicht Tokens
  • • 5-Stunden gleitendes Fenster
  • • Wöchentlicher Reset Montag 00:00
  • • Monatlicher Reset am ersten Tag des Abo-Monats
  • • Empfehlungsaktion: Empfehler erhält 10% Gutschein (unbegrenzt), Empfohlener 10% Rabatt auf das erste Abo
  • • Lite-Quota ca. 3× Claude Pro; Pro 5× Lite (5h/Woche/Monat: Lite 1900/12000/24000 Anfragen, Pro 9500/60000/120000)
  • • Quota zählt Modellaufrufe, nicht Prompts: einfache Q&A 5-15 Aufrufe pro Prompt, Refactoring/komplexe Aufgaben 15-30+
  • • Kompatibel mit Anthropic- und OpenAI-Protokollen (Claude Code, Codex, Cursor, TraeCode usw.)
  • • Auto-Modus wählt automatisch das optimale Modell je Szenario
  • • Unterstützte Modelle (Doku vom 28. Sep 2026, am 1. Okt 2026 erneut geprüft): Dola-Seed-2.0-Pro/Lite/Code, ByteDance-Seed-Code, Kimi-K2.5, GLM-5.1, GLM-5.2, GLM-5.3-Flash, DeepSeek-V4-Flash, DeepSeek-V4-Pro, DeepSeek-V4.1-Flash, GPT-OSS-120b
  • • Marketing-FAQ (am 1. Okt 2026 erneut geprüft) nennt nur Dola-Seed-2.0-pro, Dola-Seed-2.0-lite, DeepSeek-V4 Series und GLM-5.3-Flash; der Lite-Tarif bündelt Dola-Seed-2.0-pro, GLM-5.3-Flash und DeepSeek-V4 Series
  • • GLM-5.3-Flash: Zhipu natives multimodales Modell, kosteneffizient, stärker als GLM-5.2 (Bildeingabe unterstützt, 1M-Kontext)
  • • DeepSeek-V4-Flash/Pro: Early-Access-Preview-Modelle; V4-Pro hat hohen Quota-Abzugsfaktor (verbraucht Quota schnell)
  • • Deprecation angekündigt 8. Sep 2026 zum 23. Sep 2026: GLM-5.1, Kimi-K2.5, GPT-OSS-120B, ByteDance-Seed-Code — alle vier stehen weiterhin in der Doku (28. Sep 2026), fehlen aber in der Marketing-FAQ
  • • GLM-5.2, GLM-5.3-Flash, DeepSeek-V4.1-Flash, DeepSeek-V4-Flash, DeepSeek-V4-Pro unterstützen 1M-Kontextfenster
  • • Skylark-Embedding-Vision wird ebenfalls unterstützt und verbraucht Plan-Quota pro Modellaufruf, nicht pro Token
  • • Modellnamen direkt setzen oder Alias ark-code-latest nutzen; Base URL muss ark.ap-southeast.bytepluses.com/api/coding/v3 (OpenAI-kompatibel) bzw. /api/coding (Anthropic-kompatibel) sein
Canopy Wave

Canopy Wave

Aktualisiert: 2026-10-05

CA
Pay-per-use
$0/Monat
Pay-per-Token-Inferenz (0,14$-4,40$/MTok), GPU-Cloud, Coding Plan verfügbar
Coding Plan ProBeliebt
$30/Monat
Coding Plan Pro $30/month, billed monthly. Quota is weighted per model (relative to GLM-5.2 = 1.0x): Kimi-K2.6 10.5x, MiMo-V2.5 12.3x, MiniMax-M3 13.2x. Models: GLM-5.2, Kimi-K2.6, MiMo-V2.5, MiniMax-M3
Unlimited Token Plan 50M
$15.99/Monat
50.0M Tokens/Monat
50M high-speed tokens/month, then low-priority Basic Assurance Mode. Unlimited tokens & requests. Models: Kimi-K2.6, MiniMax-M3
Unlimited Token Plan 200M
$59.99/Monat
200.0M Tokens/Monat
200M high-speed tokens/month, then low-priority Basic Assurance Mode. Unlimited tokens & requests. Models: Kimi-K2.6, MiniMax-M3
Unlimited Token Plan 500M
$159.99/Monat
500.0M Tokens/Monat
500M high-speed tokens/month, then low-priority Basic Assurance Mode. Unlimited tokens & requests. Models: Kimi-K2.6, MiniMax-M3
Enterprise
Siehe Anbieter
Custom pricing and deployment

LLM Modelle (4)

Kimi-K2.6GLM-5.2MiniMax-M3MiMo-V2.5

Features

  • Multi-Modell-Wechsel
  • OpenAI-kompatible API
  • Datenschutz-geschützt (Island & Kanada Infrastruktur)
  • Datensouveränität
  • QoS-Priorisierung für IDE-Interaktionen

Hinweise

  • • Infrastruktur läuft ausschließlich in Island und Kanada für Datensouveränität
  • • OpenAI-kompatibler Endpunkt — einfach Base-URL ändern
  • • Optimierte Ein-/Ausgabe-Verhältnisse für Coding-Workflows
  • • 91% Kostenersparnis vs. Claude Opus 4.6 API (laut Anbieter)
  • • Keine Quantisierung — Full-Precision-Inferenz
  • • Canopy Wave hat die SOC-2-Zertifizierung (Typ I & II) erreicht (Seitenbanner, Sep 2026)
  • • Canopy Wave & SAIHEAT haben einen Fusionsvertrag angekündigt (Seitenbanner, Sep 2026)
  • • Die Coding-Plan-Seite (Okt 2026) verkauft nur Coding Plan Pro (30$/Monat, monatliche Abrechnung); die Seite listet keine Anfragen-Quota mehr, nur die modellgewichteten Quota-Faktoren relativ zu GLM-5.2 (1,0x): Kimi-K2.6 10,5x, MiMo-V2.5 12,3x, MiniMax-M3 13,2x; die Unlimited-Token-Stufen (50M/200M/500M) werden nur in Kunden-Testimonials erwähnt
Cerebras Code

Cerebras Code

Aktualisiert: 2026-10-05

US
Free
$0/Monat
0$, Test-Tier mit begrenzten Gratis-Credits (limited tokens/requests)
DeveloperBeliebtEingestellt
$10/Monat
$10/Monat jährlich
Eingestellt. Ersetzt durch neue Free/Pro/Max-Tiers
Pro
$50/Monat
50$/Monat, bis zu 24M Tokens/Tag (ausverkauft)
Max
$200/Monat
200$/Monat, bis zu 120M Tokens/Tag (ausverkauft)
Enterprise
Siehe Anbieter
Contact sales for custom deployment

LLM Modelle (1)

GLM-4.7

Features

  • Schnellste Inferenz der Welt (20x schneller als GPU)
  • Wafer-Scale Engine
  • Hohe Kontext-Vervollständigungen
  • Multi-Agenten-Systeme
  • IDE-Integrationen
  • Code-Refactoring

Hinweise

  • • Free: 0$ Test-Tier mit begrenzten Gratis-Credits. Pro/Max vorübergehend ausverkauft. Jetzt betrieben mit Z.ai GLM-4.7
  • • Pro: 50$/Monat, bis zu 24M Tokens/Tag (ausverkauft). Max: 200$/Monat, bis zu 120M Tokens/Tag (ausverkauft)
  • • SOLD-OUT-Badge bei Pro und Max auf /code erneut bestätigt (5. Okt 2026, Raw-HTML); die Support-FAQ-Seite existiert weiterhin nicht (404), daher sind nur die Token-Limits von der /code-Seite verifizierbar
  • • Developer-10$-Plan eingestellt (Aug 2026)
  • • 20x schnellere Inferenz als GPU-basierte Systeme
  • • Modelle gehostet auf Wafer-Scale Engine für extreme Durchsatzleistung
  • • Nahezu 100% Auslastung aufgrund hoher Nachfrage; Wartezeiten in Spitzenzeiten möglich
  • • Monatsabo, Vorauszahlung, keine anteiligen Erstattungen
  • • Enterprise: Custom Model-Gewichte, Fine-Tuning, dedizierter Support
  • • Coding-Abos betrieben mit GLM-4.7, ersetzt GPT-OSS-120B/Gemma-4-31B-Produktionsstack
Chutes

Chutes

Aktualisiert: 2026-10-04

US
BaseEingestellt
$3/Monat
300 Anfragen/Tag, Einstiegsstufe — auf der Pricing-Seite eingestellt (in llms.txt noch gelistet)
Plus
$10/Monat
2.000 Anfragen/Tag gebündelt, 6% Rabatt auf PAYG-Tarife über das Kontingent hinaus, OpenAI-kompatible API
ProBeliebt
$20/Monat
5.000 Anfragen/Tag gebündelt, 10% Rabatt auf PAYG-Tarife über das Kontingent hinaus, TEE-verschlüsselte Inferenz
Enterprise
Siehe Anbieter
Individuelle Preise. Volumenrabatte, individuelle Rate-Limits, dedizierter Support

LLM Modelle (14)

GLM-5.2GLM-5.1Kimi-K3Kimi-K2.6Qwen3-235B-A22B-Thinking-2507Qwen3.5-397B-A17BQwen3.8-27BQwen3.6-27BQwen3-32BDeepSeek-V3.2DeepSeek-V4-Flash-0731Gemma-4-31B-turboMistral-Nemo-Instruct-2407Nemotron-3-Nano-Omni-30B

Features

  • TEE (Trusted Execution Environment) GPU-Compute
  • Post-Quantum-verschlüsselte Inferenz
  • OpenAI-kompatibler Endpunkt
  • Keine Zwischenhändler, keine Aufschläge
  • Fokus auf Open-Weight-Modelle
  • Private Deployments ab 1,80$/h

Hinweise

  • • Pay-per-Token ist jetzt die primäre Preisgestaltung — kein Abo nötig. Optionale Monatspläne: Plus 10$/Monat (2.000 gebündelte Anfragen/Tag, 6% Rabatt auf PAYG über Kontingent), Pro 20$/Monat (5.000 gebündelte Anfragen/Tag, 10% Rabatt auf PAYG)
  • • Die Pricing-Seite listet nur noch Plus und Pro; Base 3$/Monat (300 Anfragen/Tag) ist dort eingestellt, wird aber noch im Index chutes.ai/llms.txt beschrieben (Dokumentations-Drift)
  • • Alle vorgestellten Modelle laufen auf vertraulicher TEE-Compute; der Live-Katalog listet 14 Modelle (verifiziert am 04.10.2026 via chutes.ai/pricing + chutes.ai/llms.txt, Katalog-Zeitstempel "Oct 4, 2026")
  • • Monatspläne werden inzwischen als "optional" positioniert — Pay-per-Token ist der Standard, kein Abo nötig
  • • Private Chutes: eigenes Modell auf TEE-GPUs ab 1,80$/h + einmalige Deploy-Gebühr vom 3-fachen Stundensatz (5,40$ bei 1,80$/h); 1 verifizierte Self-Serve-TEE-GPU-Klasse (RTX Pro 6000, 96GB Blackwell)
  • • Unterstützt TAO (Bittensor) Wallet-Zahlungen
Claude / Anthropic

Claude / Anthropic

Aktualisiert: 2026-10-05

US
Free
$0/Monat
Kostenlos für alle. Chat im Web/iOS/Android/Desktop. Ohne Claude Code/Cowork (Modelle: Sonnet 5.5 + Haiku 4.5)
ProBeliebt
$20/Monat
$17/Monat jährlich
Pro $20/Monat, Max $100-200/Monat, Team $20-25/Sitz, Enterprise $20/Sitz+Nutzung
Max 5x
$100/Monat
5x mehr Nutzung als Pro, frühzeitiger Zugang zu Features
Max 20x
$200/Monat
20x mehr Nutzung als Pro, Priority-Verarbeitung
Team Standard
$25/Monat
$20/Monat jährlich
25$/Sitz/Monat (20$ jährlich), geteilte Team-Nutzung, Admin-Kontrollen
Team Premium
$125/Monat
$100/Monat jährlich
125$/Sitz/Monat (100$ jährlich), 5x Standard-Nutzung, Priority-Support

LLM Modelle (11)

Claude MythosClaude Fable 5.1Claude Fable 5Claude Opus 5.5Claude Opus 5Claude Opus 4.8Claude Opus 4.7Claude Opus 4.6Claude-Sonnet-5.5Claude Sonnet 5Claude Haiku 4.5

Features

  • Vision-Unterstützung
  • Web-Suche
  • Erinnerungen über Gespräche
  • Code-Ausführung
  • Artifacts
  • Research
  • Skills
  • MCP-Konnektoren
  • Sprachmodus

Hinweise

  • • Free-Tier: nur Chat (ohne Claude Code/Cowork/Design/Science). Basierend auf Claude Sonnet 5.5 + Haiku 4.5
  • • Pro: 20$/Monat monatlich oder 17$/Monat jährlich (200$ im Voraus)
  • • Max: Ab 100$/Monat, wähle 5x oder 20x mehr Nutzung
  • • Alle kostenpflichtigen Pläne enthalten Claude Code, Claude Cowork, Claude Design, Claude Science
  • • Neueste Modelle: Fable 5.1, Opus 5.5, Sonnet 5.5, Haiku 4.5, dazu Mythos; Sonnet 5 ist jetzt ein Legacy-Modell
  • • API-Raten: Sonnet 5.5 2$/10$ MTok, Opus 5.5 4$/20$, Fable 5.1/Fable 5 10$/50$, Haiku 4.5 1$/5$
  • • Nutzungslimits: rollendes 5-Stunden-Fenster + wöchentliche Limits; wöchentliche Resets werden in den Einstellungen getrennt für alle Modelle und für Fable angezeigt, Überschuss wird zu API-Raten abgerechnet
  • • Relative Nutzung pro 5-Stunden-Session: Pro mindestens 5x Free, Max 5x oder 20x Pro, Team Standard mehr als Pro und Team Premium 5x Standard; Aktivität in Web, Desktop, Mobile und Claude Code zieht aus einem gemeinsamen Pool
  • • 15. Juni 2026: programmatische Nutzung wechselt in einen separaten Credit-Pool
  • • Pro ergänzt: Aufgaben übergeben und planen, Claude Design/Slides/Docs, Claude Code, Claude Science, Projekte, mehr Claude-Modelle, Claude in Chrome und Microsoft 365
  • • Legacy-Modelle: Sonnet 5 2$/10$, Opus 5 5$/25$, Fable 5, Opus 4.8, Opus 4.7, Opus 4.6, Sonnet 4.6, Sonnet 4.5, Opus 4.5
  • • Team ist für 2-150 Sitze; Self-Serve Enterprise 20$/Sitz/Monat (nur jährlich) plus Nutzung zu API-Raten
  • • Self-Serve Enterprise enthält Claude Security (beta); bei Team und Enterprise wird standardmäßig nicht mit deinen Inhalten trainiert, bei Individual-Plänen mit Opt-out
  • • Prompt-Caching (5-Minuten-TTL, MTok Lesen/Schreiben): Fable 5.1 0,25/12,50, Opus 5.5 0,20/5,00, Sonnet 5.5 & Sonnet 5 0,20/2,50, Haiku 4.5 0,10/1,25, Opus 5/4,8/4,7/4,6/4,5 0,50/6,25, Fable 5 1,00/12,50, Sonnet 4,6/4,5 0,30/3,75; Batch-API spart 50%
  • • Plattform-Add-ons: Websuche 10$/1.000 Suchen, Code-Ausführung 50 Containerstunden/Tag gratis (danach 0,05$/Stunde), Managed Agents 0,08$/Session-Stunde; US-only-Inferenz 1,1x und Fast Mode für Opus 5.5 zum doppelten Standardpreis
  • • Claude Cowork wird in Claude (Chat) integriert — "Claude Cowork is now just Claude", Ausrollen auf Pro und Max, weitere Pläne folgen (Banner auf claude.com/pricing, Sep 2026)
  • • Education-Plan (kein öffentlicher Preis): hochschulweiter Plan für Studierende, Lehrende und Personal mit reduzierten Raten, Academic-Research- und Learning-Mode sowie dedizierten API-Credits und Bildungsfeatures für Studierende
  • • Projekt-Freigabe und Zusammenarbeit ist in keinem Individual-Plan verfügbar (Free, Pro, Max); Free ist auf 5 Projekte begrenzt
Cline

Cline

Aktualisiert: 2026-10-05

US
ClinePassBeliebt
$4.99 Erster Monat
$9.99/Monat
Pauschal 9,99$/Monat, befristet erster Monat 4,99$. Open-Weight-Modelle mit großzügigen Quoten. Zusätzliche Bearbeitungsgebühr möglich

LLM Modelle (12)

GLM-5.3GLM-5.3-FlashKimi-K3DeepSeek-V4-ProDeepSeek-V4.1-FlashMiMo-V2.5MiMo-V2.5-ProMiniMax-M3Muse-Spark-1.3-ContributorQwen3.8-MaxQwen3.7-MaxQwen3.7-Plus

Features

  • Open-Weight-Modelle
  • Günstiges Abo
  • Großzügige Quoten (2-5x API-Ratenlimits)
  • Keine Provider-Einrichtung oder API-Schlüssel nötig
  • Zuverlässiger Zugang

Hinweise

  • • ClinePass: 9,99$/Monat, befristet erster Monat 4,99$. Die Fußnote der Preisseite nennt eine Aktionsphase ("Standard rate $9.99 per month after promotion period"), zeigt den Aktionspreis im Text aber nicht mehr (Stand 05.10.2026); die 4,99$ bestätigt Cline selbst in den Launch-Ankündigungen
  • • Die Modellliste der Marketing-Seite ist veraltet: dort stehen noch die eingestellten GLM-5.2, Kimi K2.6, Kimi K2.7 Code und DeepSeek V4 Flash. Die Doku (autoritativ) listet die 12 aktuellen Modelle
  • • Zusätzliche Bearbeitungsgebühr kann auf das Abo aufgeschlagen werden
  • • Quoten bieten 2-5x Nutzung im Vergleich zu Standard-API-Ratenlimits
  • • Enthält Modelle von Z.ai, Moonshot AI, DeepSeek, MiniMax, MiMo (Xiaomi) und Qwen
  • • Entwickelt für Cline IDE und CLI; andere Coding-Agenten funktionieren über den ClinePass-API-Schlüssel (OpenAI-kompatibel, api.cline.bot/api/v1/chat/completions)
  • • Jederzeit kündbar, Zugang bleibt bis zum Ende des aktuellen Abo-Zeitraums
  • • Nutzungslimits: 5-Stunden-Rolling-Fenster, wöchentlich und monatlich
  • • Modell-Einstellungen: GLM-5.2, Kimi K2.6, Kimi K2.7 Code und DeepSeek V4 Flash nicht mehr verfügbar — ersetzt durch GLM-5.3, Kimi K3 und DeepSeek-V4.1-Flash
  • • Neu (Sep 2026): DeepSeek-V4.1-Flash und Muse-Spark-1.3-Contributor
  • • Referenz-API-Raten (nicht separat abgerechnet): 0,10-3,00$/M Input, z.B. GLM-5.3 1,40$/4,40$, Kimi K3 3,00$/15,00$, DeepSeek V4 Pro 1,32$/3,96$ Peak und 0,66$/1,98$ Off-Peak
  • • ClinePass ist ein separater Provider neben der Cline-Nutzungsabrechnung — beide können unabhängig genutzt werden
  • • Referenzraten am 05.10.2026 gegen docs.cline.bot/getting-started/clinepass geprüft — 12 Modelle und alle Per-M-Raten unverändert (dort auch Cache-Read-Raten: 0,002-0,50$/M Input, Qwen Cache-Write 0,50-3,125$/M; Qwen3.7 Plus verdoppelt über 256K Tokens: 1,20$/4,80$)
CodeAnt AI

CodeAnt AI

Aktualisiert: 2026-10-05

US
Free Trial
Siehe Anbieter
14 Tage, alle Premium-Features freigeschaltet, unbegrenzte Sitze
BasicEingestellt
$10/Monat
10$/Benutzer/Monat (zuletzt verifiziert). 100 KI-Reviews/Monat. Nicht mehr auf der Preisseite gelistet (Sep 2026)
PremiumBeliebt
$24/Monat
24$/Benutzer/Monat (zuletzt verifiziert, unbegrenzte KI-Code-Reviews). Pro-Modul: Code-Security/Code-Quality/Dev-Metriken je 20$/Benutzer/Monat
Enterprise
Siehe Anbieter
Custom. Premium + Custom Contracts/MSAs, Scan-Center-Dashboard, SSO/SAML/SCIM, Audit-Log, On-Prem/VPC, SLA, dedizierte Staff Engineers & Success-Manager

LLM Modelle (3)

CodeAnt AI Code Review ModelClaude Opus 4.6GPT-5.4

Features

  • KI-Code-Review (Inline-Fixes, KI-Learnings)
  • SAST (Static Application Security Testing)
  • SCA, Secrets, IaC, SBOM-Scanning
  • KI-Pentesting (500+ Exploit-Agents)
  • DORA-Metriken / Developer 360
  • CI/CD-Integration
  • Custom Rules und KI-Learnings
  • Null Code-Speicherung
  • 1M+ PRs/Monat, 1Mrd+ LoC gescannt

Hinweise

  • • Preisseite am 05.10.2026 erneut verifiziert (in diesem Fetch kein Veröffentlichungsdatum; Footer weiterhin „Copyright © 2026 CodeAnt AI", Anschrift 355 Bryant St): weiterhin AI-Pentest-first — „Pay for real results, not promises": 1 vollständiger AI-Pentest-Scan enthalten, Low- & Medium-Findings immer kostenlos, High- & Critical-Findings werden per Zahlung freigeschaltet, KI-gestützte Exploit-Simulation + Angriffspfad-Mapping, detaillierte schritt-für-Schritt-Remediierungshinweise, OWASP-Top-10-Abdeckung. Änderung ggü. 03.10. betrifft wieder nur den Fetch, nicht die Daten: die Vergleichstabelle rendert wieder als Premium-/Enterprise-Matrix (die Plan-Feature-Zeilen vom 01.10. sind damit als aktuell bestätigt), die Preiskarten selbst sind weiterhin JS-only und der Abschnitt erscheint als leerer „Choose a plan"-Block, Premium bleibt also bei zuletzt verifizierten 24$/Benutzer/Monat. Der Kauf läuft weiterhin über App / AWS Marketplace / Microsoft Marketplace, der 14-Tage-Test (ohne Kreditkarte) wird weiterhin angeboten. Basic-10$-Tier weiterhin nicht gelistet.
  • • Premium (laut Vergleichstabelle): unbegrenzte KI-Code-Reviews, unbegrenzte PR-Zusammenfassungen & Chat, unbegrenzte Custom-Review-Prompts, 30+ Sprachen, org-weite Quality Gates, CI/CD-Integrationen, KI-Code-Review-Dashboards, Static Analysis & SAST nur auf PRs, Jira- und Azure-Boards-Integrationen, PR-Blocking für geleakte Secrets und kritische Sicherheitsprobleme, dedizierter Slack-Support, White-Glove-Onboarding, SOC-2-/HIPAA-/VAPT-Audit-Reports
  • • Enterprise (laut Vergleichstabelle): alles in Premium plus Custom Contracts, MSAs & Vendor Questionnaires, neu: Custom MSA & Contracting, Scan-Center-Dashboard, On-Prem/VPC-Deployment, SSO/SAML/SCIM + Audit-Log, SLA-Zusagen, Slack-Integration, dedizierte Staff Engineers & dedizierter Success-Manager
  • • Modular à-la-carte (zuletzt verifiziert): KI-Code-Review 24$/Benutzer/Monat, Code-Security/Code-Quality/Engineering-Metriken je 20$/Benutzer/Monat
  • • KI-Pentesting: 1 vollständiger AI-Pentest-Scan enthalten, Low- & Medium-Findings immer kostenlos, High/Critical-Findings per Zahlung freischaltbar, unbegrenzte kostenlose Re-Scans
  • • 100% Rabatt für Open-Source-Projekte (auf Mail-Anfrage), Startup-Rabatt verfügbar, Volumenpreise für große Teams. Büro jetzt 355 Bryant St, San Francisco, CA 94107
  • • Martian-Benchmark #3 global (51,7% F1) für KI-Code-Review (Feb 2026)
  • • SOC 2 Type II, HIPAA, GDPR, PCI DSS konform
  • • Gegründet 2023, 75M$+ Raised (Series B)
  • • Keine Code-Speicherung, null Datenspeicherung, kein Modell-Training auf Kundencode
  • • Bundle: KI-Code-Review + Code-Quality + Code-Security + Dev-Metriken in einem Produkt
CodeGeeX

CodeGeeX

Aktualisiert: 2026-10-05

CN
FreeBeliebt
$0/Monat
Kostenlos für immer, alle Features, keine Nutzungslimits, 100+ Sprachen
Enterprise
Siehe Anbieter
Custom (nur per Footer-Kontakt codegeex@zhipuai.cn). Soft-/Hardware-Appliance, Repo-Ebene-Vervollständigung/Q&A/RAG, Management-Plattform, privates Deployment (lokal oder Cloud), kompletter 信创-Stack, frei kombinierbare größere Modelle

LLM Modelle (1)

CodeGeeX4-ALL-9B

Features

  • Mehrsprachige Code-Generierung (100+ Sprachen)
  • Code-Vervollständigung
  • Sprachübergreifende Code-Übersetzung
  • Code-Erklärung und Kommentierung
  • Repository-Level Q&A
  • Open-Source-Modell (transparentes Training)
  • Dateiübergreifende Vervollständigung
  • Lokales Deployment (6 GB GPU-Speicher nach Quantisierung)
  • Campus-Version (校园版)
  • Enterprise-Appliance mit Management-Plattform

Hinweise

  • • Free (keine Nutzungslimits). Open-Source-CodeGeeX4-ALL-9B-Modell (von Zhipu AI). Homepage am 05.10.2026 über einen Headless-Chromium-Render erneut verifiziert (ein einfacher Markdown-Fetch liefert weiterhin nur den Platzhalter „loading..." — die Seite ist eine JS-SPA); der Footer trägt weiterhin die Copyright-©-2025-Zeile und 京ICP备20011824号-15, im Render wird kein Veröffentlichungsdatum ausgeliefert. Strukturell identisch zum 03.10.: Navigation ist 首页 / 下载 / 模型介绍 / 博客 / 使用手册 / 校园版 / 智谱开放平台, die Feature-Liste ist 代码生成与补全, 注释生成, 代码翻译, 智能问答, dazu 支持IDEs, 支持语言 und der Open-Weights-Hinweis (CodeGeex4-ALL-9B-Gewichte auf GitHub, THUDM/CodeGeeX4). Der On-Page-Enterprise-Block 企业版 / 合作咨询 (软硬一体机开箱即用, 代码仓库级补写/问答/检索增强, 企业级管理平台, 本地或云端私有化, 从硬件/OS/DB 到模型的完整信创方案, 更大尺寸模型自由组合) wird im Headless-Render vom 05.10. nicht mehr im gerenderten Ausschnitt ausgegeben, und die FAQ-Accordions (CodeGeeX是什么 / 支持哪些编程语言 / 支持哪些IDE / 是免费的吗 / 可以私有化部署?) bleiben JS-gerendert, beide behalten daher ihre Lesart vom 03.10. Weiterhin keine öffentliche Preis- oder Limits-Seite. IDE-Liste unverändert: VS Code, IntelliJ IDEA, PyCharm, WebStorm, Visual Studio, HBuilderX, GoLand, Android Studio, PhpStorm. Enterprise-Kontakt über den On-Page-Block 合作咨询 und das Footer-Mailto (codegeex@zhipuai.cn). Firmierenanschrift 中关村东路1号院9号楼10层, 北京.
Cosine (Genie)

Cosine (Genie)

Aktualisiert: 2026-10-05

GB
Starter
$19/Monat
19$/Monat. 4M Cosine-Credits/Monat, 6,50$ pro 1M Nachkauf. Vollständiger Funktionszugang
Builder
$49/Monat
49$/Monat. 11M Cosine-Credits/Monat. Für Einzelentwickler und Side-Projects
TeamBeliebt
$99/Monat
99$/Monat. 23M Cosine-Credits/Monat. Für kleine Teams
Scale
$199/Monat
199$/Monat. 47M Cosine-Credits/Monat, 5,00$ pro 1M Nachkauf. Für wachsende Teams
Professional
$999/Monat
999$/Monat. 240M Cosine-Credits/Monat, 4,50$ pro 1M Nachkauf. Für Teams mit hohem Durchsatz
Enterprise
Siehe Anbieter
Individuell. Unbegrenzte Credits, Private Deployment (Cloud/VPC/On-Prem), dedizierter Support und Compliance

LLM Modelle (2)

Lumen-OutpostLumen-Scout

Features

  • Autonomer KI-Softwareentwicklungs-Agent
  • Mehrschrittige Aufgabenplanung und -ausführung
  • PR-Erstellung mit überprüfbaren Diffs
  • Lumen-Eigenentwicklungsmodelle + 30+ Drittanbieter-Modelle (GPT, Claude, Gemini, Kimi, GLM etc.)
  • CLI-, Desktop- und Cloud-Oberflächen
  • Cosine Swarm (parallele KI-Agenten)
  • Jira/Linear/Slack-Integration
  • Red Team (KI-Penetrationstests)
  • Air-Gapped-Bereitstellung verfügbar
  • SOC 2 / ISO 27001 konform
  • Partner des britischen Sovereign-KI-Programms

Hinweise

  • • Docs-Billing am 05.10.2026 erneut verifiziert — weiterhin keine Änderung an den 6 Stufen: Starter 19$/Monat (4M Credits), Builder 49$/Monat (11M), Team 99$/Monat (23M), Scale 199$/Monat (47M), Professional 999$/Monat (240M), Enterprise individuell (unbegrenzt, privates Deployment Cloud/VPC/On-Prem, dedizierter Support und Compliance). Inkludierte Kontingente erneuern sich zu Beginn jedes Abrechnungszyklus, alle Pläne erhalten den vollen Funktionsumfang, Nachkäufe sind auf allen Plänen außer Enterprise möglich. Nachkauf-Credits laufen nie ab und werden übertragen; Voreinstellungen 20$/40$/100$/500$/1.000$/5.000$ plus individuell; der Nachkauf-Preis pro 1M ist planabhängig (Starter 6,50$, Professional 4,50$). Der Credit-Verbrauch ergibt sich aus Input-Tokens, Output-Tokens, Cache-Tokens und Reasoning-Tokens. Die Abrechnung erfolgt pro Team (jeder Account hat ein Team), bezahlte Pläne nehmen Team-Mitglieder ohne Aufpreis auf; die Seite dokumentiert außerdem, was die Billing-Seite anzeigt (monatliche Ausgaben, Credit-Guthaben getrennt nach inkludierten und Nachkauf-Credits, Nachkauf-Credits für den laufenden Zyklus) und dass Abos im Stripe-Portal verwaltet und gekündigt werden. Marketing-Seite (05.10.2026) zeigt weiterhin nur 3 bepreiste Stufen — Starter „Starting from $19/month“ (4M, 6,50$/1M), Team 199$/Monat (47M, 5,00$/1M), Enterprise 999$/Monat (240M, 4,50$/1M) — wobei Doku-Scale als Team und Doku-Professional als Enterprise relabelt werden; Doku bleibt die maßgebliche 6-Stufen-Struktur.
  • • Modelle laut docs/models am 01.10.2026 erneut verifiziert — Multiplikatoren unverändert, die Tabelle führt zusätzlich jetzt die Credit-Raten je Token-Typ (Input / Cache-Input / Output, z.B. Lumen Outpost 0,60/0,10/3, Lumen Scout 0,10/0,05/0,30), ein Long-context-Flag (GPT 5.5, GPT 5.4, GPT 5.4 1M, Gemini 3.1 Pro) sowie einen neuen Abschnitt „Models billed outside Cosine“ (eigene ChatGPT- oder GitHub-Copilot-authentifizierte Modelle werden vom jeweiligen Provider abgerechnet). Modelliste (ca. Multiplikator): Lumen Outpost (0,25x) + Lumen Scout (0,1x) proprietär; dazu GPT 5.6 Sol (2,75x), GPT 5.6 Terra (1,5x), GPT 5.6 Luna (0,5x), GPT 5.5 (2,75x), GPT 5.4 / 5.4 1M (1,5x), GPT 5.4 mini (0,5x), Codex 5.3 (1x), Fable 5 (5,5x), Opus 5 / 4.8 / 4.7 / 4.6 (2,75x), Sonnet 5 / 4.6 (1,75x), Haiku 4.5 (0,5x), Gemini 3.1 Pro (1x), Gemini 3.5 Flash (0,75x), Gemini 3 Flash (0,25x), Kimi K3 (1,75x), Kimi K3 Fast (2,5x), Kimi K2.7 Code / K2.6 (0,5x), GLM 5.2 / 5.1 (0,75x), MiniMax M2.7 (0,25x), Qwen 3.6 Plus (0,25x), DeepSeek v4 Pro (1x), DeepSeek v4 Flash (0,1x). Auto-Modus routet je nach Aufgabe. Lumen Sovereign in der Navigation als „Training Coming Soon" gelistet
CTCloud

CTCloud

Aktualisiert: 2026-10-04

CN
Points 3000
$4.14/Monat
3000 Punkte/Monat. ¥29/Monat. Unterstützt DeepSeek-V4-Pro, DeepSeek-V4-Flash-0731, GLM-5.2, GLM-5.1, Kimi-K2.6, MiniMax-M3
Points 10K
$12.71/Monat
10000 Punkte/Monat. ¥89/Monat. Unterstützt DeepSeek-V4-Pro, DeepSeek-V4-Flash-0731, GLM-5.2, GLM-5.1, Kimi-K2.6, MiniMax-M3
Points 25K
$28.43/Monat
25000 Punkte/Monat. ¥199/Monat. Unterstützt DeepSeek-V4-Pro, DeepSeek-V4-Flash-0731, GLM-5.2, GLM-5.1, Kimi-K2.6, MiniMax-M3
Points 50KBeliebt
$57/Monat
50000 Punkte/Monat. ¥399/Monat. Unterstützt DeepSeek-V4-Pro, DeepSeek-V4-Flash-0731, GLM-5.2, GLM-5.1, Kimi-K2.6, MiniMax-M3
Points 100K
$99.86/Monat
100000 Punkte/Monat. ¥699/Monat. Unterstützt DeepSeek-V4-Pro, DeepSeek-V4-Flash-0731, GLM-5.2, GLM-5.1, Kimi-K2.6, MiniMax-M3
Token 25MEingestellt
$4.14/Monat
25.0M Tokens/Monat
2500万 Tokens/Monat. ¥29/Monat — läuft aus
Token 80MEingestellt
$12.71/Monat
80.0M Tokens/Monat
8000万 Tokens/Monat. ¥89/Monat — läuft aus
Token 180MEingestellt
$28.43/Monat
180.0M Tokens/Monat
1.8亿 Tokens/Monat. ¥199/Monat — läuft aus
Token 380MEingestellt
$57/Monat
380.0M Tokens/Monat
3.8亿 Tokens/Monat. ¥399/Monat — läuft aus
Token 680MEingestellt
$99.86/Monat
680.0M Tokens/Monat
6.8亿 Tokens/Monat. ¥699/Monat — läuft aus
GLM Lite (Deprecated)Eingestellt
$7/Monat
$6/Monat jährlich
AUSVERKAUFT - Nicht mehr verfügbar
GLM Pro (Deprecated)Eingestellt
$21/Monat
$17/Monat jährlich
AUSVERKAUFT - Nicht mehr verfügbar
GLM Max (Deprecated)Eingestellt
$67/Monat
$54/Monat jährlich
AUSVERKAUFT - Nicht mehr verfügbar

LLM Modelle (6)

GLM-5.2GLM-5.1DeepSeek-V4-ProDeepSeek-V4-Flash-0731Kimi-K2.6MiniMax-M3

Features

  • Punktbasierte Pläne (neu)
  • GLM-5.2, Kimi-K2.6, MiniMax-M3 Modelle
  • CLI/IDE-Integration
  • Mehrstufige Pläne

Hinweise

  • • Neuer Punkte-Plan (积分版): 3000/10000/25000/50000/100000 Punkte pro Monat für ¥29/¥89/¥199/¥399/¥699. Unterstützt DeepSeek-V4-Pro, DeepSeek-V4-Flash-0731, GLM-5.2, GLM-5.1, Kimi-K2.6, MiniMax-M3
  • • Legacy-Token-Pläne (按Token计量) laufen aus — nur Verlängerung für Bestandskunden, keine Neukäufe. GLM-5.0 und DeepSeek-V3.2 offline ab 10.10.2026
  • • Punkte-Umtausch: 3000 Punkte ≈ 14,29M Tokens MiniMax-M3 oder 4,62M Kimi-K2.6 (Richtwerte)
  • • API: api.ctyun.cn/api/anthropic für Claude Code, api.ctyun.cn/api/coding/paas/v4 für andere
  • • Registrierung erfordert wahrscheinlich eine chinesische Festland-Rufnummer (+86)
  • • Promo: Leicht-Paket ab 9,9¥/Monat
  • • Am 4.10.2026 geprüft: beide Dokumente (weiterhin Stand 23.09.2026) unverändert — Punktpreise ¥29/¥89/¥199/¥399/¥699, die 6-Modell-Punktliste und das Offline-Datum der Legacy-Pläne (10.10.2026) sind identisch. Es werden keine Anfrage-Kontingente veröffentlicht; die Abrechnung erfolgt rein über Punkte/Tokens
Cursor

Cursor

Aktualisiert: 2026-10-04

US
Hobby
$0/Monat
Kostenlos, begrenzte Agent-Anfragen und Tab-Vervollständigungen
ProBeliebt
$20/Monat
$16/Monat jährlich
20$/Monat mit API-Nutzung inkludiert
Pro Plus
$60/Monat
$48/Monat jährlich
60$/Monat mit API-Nutzung inkludiert
Ultra
$200/Monat
200$/Monat
Teams Standard
$40/Monat
$32/Monat jährlich
40$/Benutzer/Monat, Bugbot-Reviews, SAML/OIDC SSO, Cursor Router
Teams Premium
$120/Monat
$96/Monat jährlich
120$/Benutzer/Monat, 5× Standard-Nutzung, Cursor Router
Enterprise
Siehe Anbieter
Individuelle Preise. Gepoolte Nutzung, Cursor Router, SCIM, Audit-Logs

LLM Modelle (35)

Grok-4.7Grok-4.6Grok-4.5Composer-2.5Claude Opus 5.5Claude Opus 5Claude Opus 4.8Claude Opus 4.7Claude Sonnet 5Claude-Sonnet-5.5Claude Fable 5Claude Fable 5.1GPT-5.6-SolGPT-5.6-TerraGPT-5.6-LunaGPT-5.5GPT-5.4GPT-5.3-CodexKimi-K3Kimi-K2.7-CodeGemini-3.1-ProGemini-3.8-FlashGemini-3.7-FlashGemini-3.6-FlashGemini-3.5-FlashGLM-5.3GLM-5.3-FlashGLM-5.2Muse-Spark-1.3Claude Opus 4.6Claude Sonnet 4.6Claude Haiku 4.5GPT-5.4-miniGPT-5.2-CodexGemini-3-Pro

Features

  • KI-Code-Editor
  • Agent-Modus (mehrstufiges Coding)
  • Cloud-Agents
  • Erstpartei-Cursor-Modellpool (Grok 4.7, Grok 4.6, Grok 4.5, Composer 2.5)
  • Anderer-Modellpool (Claude, GPT, Gemini, Kimi, Meta) mit nutzungsbasierter Abrechnung
  • On-Demand-Nutzung über das enthaltene Volumen hinaus
  • MCPs, Skills, Hooks
  • Bugbot Code-Reviews
  • Team-Marketplace
  • Privacy-Modus

Hinweise

  • • Hobby: Kostenlos, begrenzte Agent-Anfragen und Tab-Vervollständigungen
  • • Individual-Pläne: Pro 20$/Monat, Pro Plus 60$/Monat, Ultra 200$/Monat — jeweils zwei Nutzungspools; Docs empfehlen 60–100$/Monat für tägliche Agent-Nutzer, 200$+/Monat für Power-User
  • • Cursor-Modellpool: Grok 4.7, Grok 4.6, Grok 4.5, Composer 2.5 (großzügige enthaltene Nutzung); Anderer-Modellpool wird zu den API-Raten des jeweiligen Modells abgerechnet
  • • Listenraten Anderer Modelle (Input/Output pro 1M, verifiziert am 04.10.2026): Claude Fable 5.1 10$/50$ (Cache-Read 0,25$), Claude Fable 5 10$/50$, Claude Opus 5.5 4$/20$, Claude Opus 5/4.8/4.7/4.6 5$/25$, Claude Sonnet 5.5/5 2$/10$, Gemini 3.1 Pro 2$/12$, Gemini 3.8/3.7 Flash 0,75$/3,50$, Gemini 3.6/3.5 Flash 1,5$/7,50–9$, GPT-5.6 Sol 4$/20$, GPT-5.6 Terra 2$/12$, GPT-5.6 Luna 0,20$/1,20$, GPT-5.5 5$/30$, Kimi K3 3$/15$, Kimi K2.7 Code 0,95$/4$, GLM 5.3/5.2 1,4$/4,4$, GLM 5.3 Flash 0,15$/0,50$, Muse Spark 1.3 1,25$/4,25$
  • • Cursor-Modellpool hat zusätzlich separat abgerechnete Fast-Varianten: Grok 4.7 Fast 4$/12$, Grok 4.7 500k 4$/12$, Grok 4.7 500k Fast 6$/18$, Grok 4.6 Fast 4$/12$, Grok 4.5 Fast 4$/18$, Composer 2.5 Fast 3$/15$ (Standard: Grok 4.7/4.6/4.5 2$/6$, Composer 2.5 0,50$/2,50$); Grok 4.7 mit langem Kontext >256k Input zum 2-fachen Standardsatz (bis 500k), Fast mit langem Kontext zum 3-fachen
  • • Anderer-Modellpool: Drittanbieter-Modelle (Claude, GPT, Gemini, Kimi, GLM, Meta Muse) + 0,25$/M Cursor-Token-Rate (Teams/Enterprise); regionale Datenresidenz addiert 10% auf die Modellpreise
  • • Teams: 40$/Benutzer/Monat (Standard), 120$/Benutzer/Monat (Premium, 5× Standard-Limits) — Bugbot, Team-Marketplace, SAML/OIDC SSO, Grok Bot
  • • Auto hat drei Modi (Cost, Balance, Intelligence); auf Teams/Enterprise wählt Cursor Router das Modell pro Anfrage aus der Freigabeliste
  • • Start (nur Indien): ₹649/Monat inkl. Steuer, nur Cursor-Modellpool + Cloud-Agents, ohne Andere Modelle/Bugbot/Auto/Cursor SDK
  • • On-Demand-Nutzung über das enthaltene Volumen hinaus wird nach Verbrauch abgerechnet (API-Preise)
  • • Jahresabrechnung = 20% Rabatt (Pro 16$/Monat, Pro+ 48$/Monat)
  • • Abos nur direkt über cursor.com — keine Wiederverkäufer
  • • Privacy-Modus: Code-Daten werden nie von Modellanbietern gespeichert oder zum Training verwendet
  • • GPT-5.6 Sol/Terra/Luna haben Promo-Preise bis 21.11.2026; Claude Opus 5.5 und Sonnet 5.5 mit US-only-Endpunkten Aufschlag 10%; Claude Opus 4.7 Fast-Modus 30$/150$ (Research-Preview)
  • • Hobby inkludiert Composer-Zugang; auf Start (Indien) laufen Grok 4.7/4.6/4.5 im Non-Fast-Modus mit festem mittlerem Effort-Level, Effort ist nicht änderbar
  • • Am 04.10.2026 erneut geprüft gegen cursor.com/pricing und cursor.com/docs/account/pricing — Planpreise, Nutzungspools, alle Modellraten und Teams-Sitz-Stufen unverändert
Edlide

Edlide

Aktualisiert: 2026-10-04

US
Entry
$6.99 Erster Monat
$14/Monat
300 Anfragen/Tag, 15$ Token/Monat, GLM-4.7 & Mimo-v2-flash & DeepSeek-V3.2, volles Kontextfenster. Einführung 6,99$/Monat (−50%)
ProBeliebt
$19.99 Erster Monat
$40/Monat
2.000 Anfragen/Tag, 50$ Token/Monat, GLM-4.7 & GLM-5 & Kimi-K2.5 & MiniMax-M2.5 & Qwen-3.5, volles Kontextfenster. Einführung 19,99$/Monat (−50%)
Max
$34.99 Erster Monat
$70/Monat
5.000 Anfragen/Tag, 100$ Token/Monat, GLM-4.7 & GLM-5 & Kimi-K2.5 & MiniMax-M2.5 & Qwen-3.5, volles Kontextfenster. Einführung 34,99$/Monat (−50%)

LLM Modelle (7)

GLM-5GLM-4.7Kimi-K2.5MiniMax-M2.5Qwen-3.5Mimo-v2-flashDeepSeek-V3.2

Features

  • Nur Open-Source-Modelle
  • Confidential Compute (dezentralisiert)
  • 100% privat — kein Anbieter-Zugriff auf Prompts
  • Native Quantisierung
  • VS Code-basierte IDE + CLI
  • Feste tägliche Anfrage-Kontingente

Hinweise

  • • Drei Stufen mit festen täglichen Anfrage-Kontingenten und gebündelten Token-Mengen: Entry 14$/Monat (6,99$ Einführung, 300 Anfragen/Tag), Pro 40$/Monat (19,99$ Einführung, 2.000 Anfragen/Tag), Max 70$/Monat (34,99$ Einführung, 5.000 Anfragen/Tag)
  • • Token-Credits: Entry 15$, Pro 50$, Max 100$ pro Monat
  • • Open-Source-KI-Modelle haben zu geschlossenen Alternativen aufgeschlossen und kosten ~10× weniger (laut Anbieter)
  • • Confidential Compute auf dezentraler Infrastruktur
  • • Native Quantisierung — signifikanter Einfluss auf Inferenz-Performance
  • • Reine Inferenz, kein Anbieter-Zugriff auf Prompts oder Code
  • • Pricing-Seite durch Cloudflare-Bot-Schutz blockiert (403, am 04.10.2026 via Webfetch erneut bestätigt) — Daten am 04.10.2026 via Websuche von edlide.com/pricing und Aggregator-Spiegeln erneut verifiziert; alle drei Stufen (14$/40$/70$ mit Einführung 6,99$/19,99$/34,99$), Kontingente und Modelle pro Stufe unverändert
Fireworks

Fireworks

Aktualisiert: 2026-10-05

US
Pay-as-you-go
$0/Monat
Pay-per-Token Serverless-Inferenz. On-Demand-GPU verfügbar.
Fire PassBeta
Siehe Anbieter
Invite-only subscription. Zero per-token costs. kimi-fast-latest: 1.04M context, 131k output. Not open to new subscriptions. Experimental — subject to change

LLM Modelle (1)

Kimi-K3-Fast

Features

  • Serverless-Inferenz (Pay-per-Token)
  • On-Demand-GPU (H100, H200, B200, B300)
  • Fine-Tuning verfügbar
  • OpenAI-kompatible API
  • Schnelle Inferenz mit Custom-Kernels
  • Multi-Modal-Unterstützung

Hinweise

  • • Pay-per-Token Serverless-Inferenz. On-Demand-GPU (ab 1. Sep): H100 8$/Std, H200 8$/Std, B200 13$/Std, B300 15$/Std, GB300 20$/Std. Fine-Tuning verfügbar.
  • • Fire Pass: Unverändert nicht für neue Abos geöffnet — bestehende Nutzer und Promo-Empfänger können ihren Pass verwalten. Keine Per-Token-Kosten. Modell: kimi-fast-latest (Kimi K3 Fast), 1.040.000 Token Kontextfenster, bis zu 131.072 Output-Tokens.
  • • Fire Pass unterstützt Claude Code, OpenCode, Pi, Cursor IDE, VS Code Chat, GitHub Copilot (App + CLI), DeepSeek Harness, Cline, Kilo Code, OpenClaw, LangChain Deep Agents
  • • Codex CLI und ChatGPT Desktop werden nicht unterstützt (Responses API akzeptiert keine Fire-Pass-Schlüssel); fpk_-Schlüssel können auto/auto-instant/FireRouter nicht nutzen
Firmware

Firmware

Aktualisiert: 2026-10-05

US
Free
$0/Monat
Kostenlos für bis zu 10 Benutzer. Sidekick Fast, begrenzte AI-Nutzung, volle Task-Verwaltung, 1 Doc Flow, 2 GB Speicher
StarterBeliebt
$25/Monat
Sidekick Pro, beliebiges Modell wählen, 100 Bilder/Monat, 5 Doc Flows, 250 GB Speicher
Pro
$100/Monat
5x Nutzung pro Session, 500 Bilder/Monat, unbegrenzter Speicher, früherer Zugang zu fortgeschrittenen Claude-Features, Prioritätszugang bei hoher Auslastung

LLM Modelle (36)

Claude Fable 5Claude Opus 5Claude Sonnet 5Claude Opus 4.8Claude Opus 4.7Claude Sonnet 4.6Claude Haiku 4.5GPT-5.6-SolGPT-5.6-TerraGPT-5.6-LunaGPT-5.5GPT-5.3-CodexGPT-5.4-miniGPT-5.4-nanoGPT-4oGPT-OSS-120BGPT-OSS-20BGemini-3.6-FlashGemini-3.1-ProGemini-3-FlashGemini-3.1-Flash-LiteGemini-2.5-ProGemini-2.5-FlashGrok-4.5Grok-4.3Grok-4.1-FastGrok-Code-Fast-1GLM-5.3GLM-5.3-FlashGLM-5.2DeepSeek-V4-ProQwen3.7-PlusKimi-K3Kimi-K2.7-CodeKimi-K2.6MiniMax-M3

Features

  • Browser-Automatisierung (Sidekick)
  • Multi-Provider-Modellzugang
  • Doc Flows
  • Bildgenerierung (DALL-E-3, Imagen 4)
  • Audio-Transkription (ElevenLabs, Whisper)
  • Embeddings (OpenAI, Voyage, Google)
  • Rerank (Voyage)
  • Browser Agent MCP
  • Credit-basiertes System
  • Bis zu 1,04M Kontext (DeepSeek V4 Pro, Kimi K3, GLM 5.3)

Hinweise

  • • Kostenlos (bis zu 10 Benutzer), Starter 25$/Benutzer/Monat (Sidekick Pro, 100 Bilder/Monat), Pro 100$/Benutzer/Monat (5x Nutzung, Prioritätszugang bei hoher Auslastung).
  • • Guthaben-Abrechnung: Abo + Top-up werden zu USD-Guthaben, Abrechnung zu exakten Providerkosten, ohne Aufschlag. Doku (balance-usage-pricing): 10-500 $ über die Billing-Seite aufladen, gekauftes Guthaben verfällt nicht, Anfragen stoppen bei 0 $. Base URL https://app.frogbot.ai/api
  • • Die Modellliste der Doku (api-reference/models) führt DeepSeek nur als deepseek-v4-pro — kein V4 Flash; ein Key deckt Chat, Embeddings, Audio, Bildgenerierung und Rerank ab
  • • Die Modellliste folgt der kuratierten subscription-intro-Liste (in Free/Starter/Pro enthalten). Die erweiterte Frogbot-API-Registry (api-reference/models) bietet zusätzlich claude-opus-4-6/-4-5, claude-sonnet-4-5, gpt-5.2, gpt-5, gpt-4.1, gemini-2.5-flash-lite, deepseek-r1, kimi-k2-thinking, zai-glm-4.7-flash, f1, f1-flash und f1-pro — diese werden als Guthaben-Nutzung abgerechnet, nicht über das Plan-Kontingent
GitHub Copilot

GitHub Copilot

Aktualisiert: 2026-10-05

US
Free
$0/Monat
2.000 Vervollständigungen/Monat, AI-Credits-Guthaben, nur automatische Modellauswahl
Student
$0/Monat
Kostenlos für verifizierte Studenten. Automatische Modellauswahl, keine Drittanbieter-Agenten
ProBeliebt
$10/Monat
1.500 AI-Credits/Monat, unbegrenzt Vervollständigungen, Cloud-Agent, Code-Review, Drittanbieter-Agenten (Claude Code, Codex)
Pro+
$39/Monat
7.000 AI-Credits/Monat, Premium-Modelle (Opus), Audit-Logs
Max
$100/Monat
20.000 AI-Credits/Monat, priorisierter Zugriff auf neue Modelle/Features
Business
$19/Monat
Gepoolte Credits, Governance, Lizenzverwaltung, Richtlinien, IP-Schadlosstellung (Seats vorab bezahlt; Neuanmeldungen pausiert)
Enterprise
$39/Monat
2× inkludierte Nutzung vs Business, github.com-Chat mit Wissensdatenbanken, angepasste Modelle, organisationsweite Richtlinien (Neuanmeldungen pausiert)

LLM Modelle (30)

Claude Opus 5.5Claude Opus 5Claude Opus 4.8Claude Opus 4.8 (fast mode) (preview)Claude Sonnet 5Claude-Sonnet-5.5Claude Sonnet 4.6Claude Fable 5Claude Fable 5.1Claude Haiku 4.5GPT-5.6-SolGPT-6-SolGPT-6.1-SolGPT-6-LunaGPT-5.6-TerraGPT-5.6-LunaGPT-5.5GPT-5.4GPT-5.3-CodexGPT-6-AstraGPT-5-miniGPT-5.4-miniGemini-3.7-FlashGemini-3.8-FlashGrok-4.7Grok-4.6Grok-4.5Kimi-K3MAI-Code-1.1-FlashGPT-5.4-nano

Features

  • KI-Pair-Programmierung
  • Code-Vervollständigungen
  • Chat-Unterstützung
  • Agent-Modus
  • CLI-Integration
  • Code-Review
  • MCP-Unterstützung
  • Multi-IDE-Unterstützung
  • GitHub.com-Integration
  • IP-Schadlosstellung

Hinweise

  • • Am weitesten verbreitetes KI-Developer-Tool weltweit
  • • Nativ in GitHub integriert - anders als andere KI-Coding-Assistenten
  • • Integriert mit führenden Editoren: VS Code, Visual Studio, JetBrains, Neovim
  • • Credits-basierte Abrechnung: 1 Credit = 0,01$
  • • Code-Vervollständigungen und Next-Edit-Vorschläge verbrauchen keine Credits (unbegrenzt auf Paid-Plänen)
  • • Credits für Chat, Agenten, CLI, Spaces, Spark
  • • Modellverfügbarkeit variiert je Plan: die meisten Modelle in Pro; Premium-Modelle (GPT-5.5, GPT-5.6 Sol, Claude Opus) in Pro+ und Max. Free/Student: nur automatische Modellauswahl
  • • Claude Opus 4.8 und Gemini 3.5 Flash jetzt verfügbar
  • • Claude Opus 5, Grok 4.6, Gemini 3.6/3.7 Flash, Claude Fable 5, MAI-Code jetzt verfügbar
  • • Gemini 3.8 Flash, GPT-5.4 mini jetzt verfügbar
  • • Claude Sonnet 5.5 jetzt verfügbar in Pro/Pro+/Max
  • • Grok 4.7 jetzt verfügbar in Pro/Pro+/Max
  • • Pro/Pro+/Max/Student/Business/Enterprise: gelistet. Business 19$/Seat, Enterprise 39$/Seat; Seats werden vorab bezahlt. Business/Enterprise: Neuanmeldungen weiterhin pausiert (Stand 5. Okt 2026: "we're gradually enabling new sign-ups")
  • • Modelltabelle der Plans-Seite am 5. Okt 2026 erneut geprüft: 30 Modelle, identisch für Individual- und Business/Enterprise-Pläne. GPT-6.1 Sol ins Modell-Array aufgenommen; Claude Opus 4.7, Gemini 3.5 Flash, Gemini 3.6 Flash und Kimi-K2.7-Code bleiben entfernt
  • • Monatlicher Credit-Wert der inkludierten Nutzung: Pro 15$, Pro+ 70$, Max 200$ (Pro+ 4x+ und Max 2,9x+ die inkludierte Pro-Nutzung)
  • • Claude Opus 4.8, 4.8 (Fast Mode), 5 und 5.5, GPT-5.5, GPT-5.6 Sol, GPT-6 Sol, GPT-5.4 nano: nur Pro+ und Max. GPT-5.4 nano zusätzlich nur in der Codex-VS-Code-Extension (Pro+ only, nicht im Copilot Chat)
  • • GPT-6 Astra und Claude Fable 5.1: nur Pro+ und Max
  • • Claude Fable 5/5.1-Anfragen laufen bis Ende 2026 über den ZDR-Endpoint (Zero Data Retention) (Enterprise-tauglich, zeitlich befristete Ausnahme)
  • • GPT-6-Luna jetzt verfügbar in Pro/Pro+/Max
  • • GPT-6.1 Sol jetzt verfügbar in Pro/Pro+/Max sowie Business/Enterprise
  • • Claude Sonnet 4.6: nur Pro und Pro+ (nicht bei Max/Business/Enterprise)
  • • Drittanbieter-Agenten: Claude Code und Codex (Pro und höher)
  • • Monatliche AI-Credits: Pro 1.500, Pro+ 7.000, Max 20.000. Copilot Student: AI-Credits-Guthaben
  • • Copilot Cloud-Agent und Code-Review in Paid-Plänen enthalten
  • • Copilot Student: kostenlos für verifizierte Studenten (automatische Modellauswahl, keine Drittanbieter-Agenten)
  • • Copilot Pro ist für einige Nutzer kostenlos: verifizierte Lehrkräfte und Maintainer von populären Open-Source-Projekten
  • • Free-Tier bleibt für alle offen
  • • Copilot ist derzeit nicht für GitHub Enterprise Server verfügbar
GitLab Duo

GitLab Duo

Aktualisiert: 2026-10-05

US
Free (Duo Classic)
$0/Monat
AI Chat in IDE, Code-Vorschläge enthalten mit Free-Tier (GitLab Duo Core). Monthly Commitment Pool auch ohne Premium/Ultimate kaufbar
PremiumBeliebt
$29/Monat
$29/Monat jährlich
$29/User/Monat (jährlich), enthält $12 GitLab Credits/User/Monat für Duo Agent Platform
Ultimate
Siehe Anbieter
Custom Pricing (Kontakt Sales), enthält $24 GitLab Credits/User/Monat für Duo Agent Platform

LLM Modelle (43)

Claude Fable 5Claude Fable 5.1Claude Opus 5.5Claude Opus 5Claude Opus 4.8Claude Opus 4.7Claude Opus 4.6Claude Opus 4.5Claude Sonnet 5Claude-Sonnet-5.5Claude Sonnet 4.6Claude Sonnet 4.5Claude Sonnet 3.7Claude Sonnet 3.5Claude Haiku 4.5Claude Haiku 3Codestral-2501GPT-5.6-SolGPT-5.6-TerraGPT-5.6-LunaGPT-6-AstraGPT-6-SolGPT-6.1-SolGPT-6-LunaGPT-5.5GPT-5.4GPT-5GPT-5.1GPT-5.2GPT-5.2-CodexGPT-5.3-CodexGPT-5-CodexGPT-5.4-miniGPT-5.4-nanoGPT-5-miniGemini-3.8-FlashGemini-3.7-FlashGemini-3.6-FlashGemini-3.5-FlashGemini-2.5-FlashMiniMax-M3GLM-5.3Kimi-K3

Features

  • Agentic Chat mit Multi-Step-Reasoning
  • Code-Vorschläge (50 Ausführungen/Credit)
  • Code-Review-Flow (4 Ausführungen/Credit)
  • SAST-False-Positive-Detection-Flow (1 Ausführung/Credit)
  • SAST-Vulnerability-Resolution-Flow (0,25 Ausführungen/Credit)
  • Fundamentale Agents (Planer, Security-Analyst, Data-Analyst)
  • Fundamentale Flows (Issue zu MR, Pipeline-Fix, Konvertierung zu GitLab CI)
  • Modell-Auswahl pro Feature
  • AI-Katalog für Agent/Flow-Management
  • Custom Agents & Flows
  • Externe Agent-Integration (Claude Code, Codex)
  • MCP-Integrationen
  • Self-Hosted-Modelle-Option (8 Requests/Credit, 20% Rabatt auf Flat-Pricing-Features)
  • IP-Schadlosstellung
  • Privacy-First (privater Code nicht für Training verwendet)

Hinweise

  • • Kostenlos (AI über GitLab Credits-Add-on), Premium 29$/Benutzer/Monat (12$ Credits/Benutzer/Monat-Promo), Ultimate (24$ Credits). Credits bei On-Demand-Kauf 1$/Credit; Monthly Commitment Pool wird über die Duo Agent Platform geteilt. Modell-Multiplikatoren laut Credits-Doku (Calls pro Credit): Basis-Modelle 8,0 (Codestral 2501, Gemini 2.5 Flash, GPT-5 Mini, GPT-5.4 Nano). Premium-Modelle: GPT-5.6 Luna, GPT-6 Luna, MiniMax-M3 8,0; Claude 4.5 Haiku 6,7; Gemini-3.6/3.7/3.8-Flash 6,7 (Promo bis 31. Dez. 2026, danach ~3,3); GPT-5.4 Mini 6,7; GLM-5.3 5,0; Gemini-3.5-Flash, GPT-5, GPT-5-Codex 3,3; Claude Sonnet 5 / 5.5 3,2; GPT-6-Sol und GPT-6.1-Sol 2,86 (kurzer Kontext)/1,54 (langer Kontext); GPT-5.2, GPT-5.2/5.3-Codex 2,5; GPT-5.6-Terra 2,5 (kurzer)/1,43 (langer); Claude Sonnet 4.5, 4.6, GPT-5.4 (kurzer) 2,0; Kimi-K3 1,82; Claude Opus 5.5 1,35; Claude Opus 5, 4.6, 4.7, 4.8 1,1; Claude Opus 4.5 1,2; Claude Fable 5, 5.1 0,6; GPT-6-Astra 0,54 (kurzer)/0,31 (langer). GPT-5.6-Sol bis 21. Nov. 2026 im Promo: 1,33 (kurzer)/0,76 (langer), danach ~1,0/0,57. Kurzer Kontext = bis 272k Tokens, langer Kontext = mehr als 272k Tokens.
  • • Free-Namespaces können einen Monthly Commitment Pool ohne Premium/Ultimate kaufen; On-Demand-Nutzung ist dort auf 25.000 $ pro Kalendermonat gedeckelt und danach bis zum Monatsende abgeschaltet
  • • GitLab Duo Pro und Enterprise sowie die zugehörigen Duo-Features werden nicht nutzungsbasiert abgerechnet und verbrauchen keine GitLab Credits
  • • Kostenloser temporärer Evaluierungs-Pool (30 Tage, über Sales anzufordern), wenn weder Monthly Commitment Pool noch On-Demand-Bedingungen akzeptiert wurden
  • • Self-Hosted-Modelle: 8 Requests pro Credit; Features auf einem Self-Hosted-Modell erhalten 20% Credit-Rabatt (Code Suggestions 62,5, Code Review Flow 5, SAST FP 1,25, SAST Vuln Resolution 0,3125 Ausführungen/Credit)
  • • Abrechnung erfolgt auf Root-Namespace- oder Top-Level-Group-Ebene und wird der handelnden Person bzw. dem Nicht-Menschen-Subjekt zugeordnet; enthaltene Credits werden monatlich zurückgesetzt, nicht übertragen und weder an Nicht-Menschen-Subjects noch an Community-Programm-Abonnements vergeben
  • • GPT-5.1 ist für Agentic Chat und Agents auswählbar (hinzugefügt nach GLM 5.3, Kimi K3, MiniMax M3 am 16. Sep. 2026 und GPT-6 Sol/Luna am 22. Sep. 2026); Credit-Multiplikator noch nicht veröffentlicht
  • • GitLab Flex (neu, nur über Sales buchbar): eine Jahresverpflichtung, die sowohl Seats als auch GitLab Credits umfasst und zwischen GitLab-Plänen und Nutzung umverteilt werden kann; reservierte Credits sind use-it-or-lose-it und verfallen zum Monatsende, On-Demand über der Reservierung wird zum Listenpreis von 1 $/Credit abgerechnet
  • • Auch GitLab Secrets Manager wird über Credits abgerechnet (nicht agentisch), ebenso gehostete Runner für GitLab Dedicated; Enterprise Agile Planning Add-on 15 $/Benutzer/Monat auf Ultimate
Google Antigravity

Google Antigravity

Aktualisiert: 2026-10-05

US
Individual (Free)
$0/Monat
Unbegrenzte Tab-Vervollständigungen, unbegrenzte Command-Anfragen, Basis-Rate-Limits. Zugang zu Gemini 3.8 Flash, Gemini 3.7 Flash, Gemini 3.6 Flash, Gemini 3.1 Pro, Claude Sonnet & Opus 4.6, gpt-oss-120b
Google AI Plus
$4.99/Monat
Großzürigere Tab-Vervollständigungen und Basis-Rate-Limits als Free. Google AI Plus (4,99$/Monat 400GB oder 9,99$/Monat 2TB; reduziert von 7,99$/200GB am 8. Juni 2026). Nicht auf der aktuellen Antigravity-Preisseite, behält aber Agent-Zugang (Modellset wie Free) laut docs/models
Google AI ProBeliebt
$19.99/Monat
Großzürigere Rate-Limits, flexibler AI-Credit-Pool. Im Google AI Pro-Abonnement enthalten
Google AI Ultra 5x
$99.99/Monat
5x Pro-Nutzungslimits, höhere Priorität für Gemini 3.1 Pro, 20TB Speicher. Im Google AI Ultra-Abonnement enthalten (neu auf der I/O 2026)
Google AI Ultra Max 20x
$199.99/Monat
20x Pro-Nutzungslimits (praktisch kein Wochenlimit), höchste Priorität. War früher Google AI Ultra 249,99$, auf 199,99$ gesenkt (I/O 2026)
Organization
Siehe Anbieter
Business plan via Google Cloud — access to Antigravity 2.0, CLI and IDE extensions, priced as API access with consumption-based billing (Contact Sales). Gemini Enterprise Standard/Plus plans start at $30 USD per seat/month; pay-as-you-go plan has a $0 seat fee. Spend caps across API and subscription plans plus centralized admin controls with eligible subscription plans. Existing Gemini Enterprise customers with an invoiced Cloud billing account can enable AI Developer tools via the setup guide. Custom pricing

LLM Modelle (8)

Gemini-3.8-FlashGemini-3.7-FlashGemini-3.6-FlashGemini-3.1-ProClaude Opus 4.6Claude Sonnet 4.6GPT-OSS-120BNano Banana 2

Features

  • Multi-Modell-Wechsel (Gemini, Claude, GPT-OSS)
  • Parallele Sub-Agents (bis zu 5)
  • MCP-Unterstützung
  • Integrierter Browser-Test
  • Unbegrenzte Tab-Vervollständigungen
  • 2M+ Kontextfenster
  • Geplante Aufgaben
  • Credit-Überziehungssystem
  • Remote-Ausführungs-Sandboxen
  • IP-Schadlosstellung

Hinweise

  • • Allgemein verfügbar. Individual (kostenlos), Google AI Pro (19,99$/Monat), Google AI Ultra 5x (99,99$/Monat), Google AI Ultra Max 20x (199,99$/Monat). Google AI Plus (4,99$/Monat, Gemini-App-Plan) behält Antigravity-Zugang
  • • Preisseite (Sep 2026): Individual (0$), Google AI Pro, Google AI Ultra und Organizations-Plan (via Google Cloud); Google AI Plus dort nicht aufgeführt, Zugang laut docs/models bestätigt
  • • Free: unbegrenzte Tab-Vervollständigungen, unbegrenzte Command-Anfragen, Basis-Rate-Limits, Zugang zu Gemini 3.8 Flash, Gemini 3.7 Flash, Gemini 3.6 Flash, Gemini 3.1 Pro, Claude Sonnet & Opus 4.6, gpt-oss-120b
  • • Kontingent-Refresh: Free wöchentlich, Pro/Ultra 5-Stunden-Refresh bis zum Wochenlimit
  • • Kontingent-Tiers (docs/plans): Ultra = höchstes Kontingent mit 5-Stunden-Refresh, höchste Wochenrate-Limits, Zugang zu Drittanbieter-Modellen; Pro = hohes Kontingent, 5-Stunden-Refresh bis zum Wochenlimit, höheres Wochenlimit; alle übrigen Nutzer = spürbares Kontingent mit wöchentlichem Refresh. Die Rate Limits korrelieren mit der Agent-Arbeit, nicht mit der Prompt-Anzahl — einfachere Aufgaben ergeben daher mehr Prompts
  • • Überschreitung über Plan-Kontingent: nur bei Google AI Pro/Ultra und nur mit gekauften AI-Credits (oder einmaligen Promo-Credits), verbraucht zu Standard-Gemini-Enterprise-Consumption-Preisen. Steuert die Nutzereinstellung "AI Credit Overages": "Never" = auf Kontingent-Refresh warten, "Always" = Credits sofort nutzen und nach Refresh zurückwechseln. Kein BYOK, keine Organisations-Tiers per Vertrag
  • • Reasoning-Modell-Verfügbarkeit (docs/models): Gemini 3.x in allen Plänen inkl. Enterprise; Claude Sonnet/Opus 4.6 und GPT-OSS-120b bei Free, Google AI Plus, Pro und Ultra — nicht bei Enterprise
  • • Auch über Google Cloud verfügbar (Organizations-Plan, verbrauchsbasierte API-Preise)
  • • Google-Cloud-Kunden können jetzt Antigravity 2.0 und die CLI nutzen; verbrauchsbasierte API-Preise mit Gemini Enterprise, enthalten in ausgewählten Gemini-Enterprise-Abonnements (Rollout für ausgewählte Kunden)
  • • Organizations-Plan (Preisseite, am 1. Okt. 2026 erneut geprüft): "Business plan" via Google Cloud mit Contact Sales, Zugang per API zu verbrauchsbasierten Preisen; für berechtigte Gemini-Enterprise-Kunden Standard/Plus ab 30 USD pro Seat und Monat oder ein Pay-as-you-go-Plan mit 0 $ Seat-Gebühr. Vorteile: Google-Cloud-AGB, Spend-Caps über API- und Abonnementpläne hinweg, zentrale Administrationskontrollen bei berechtigten Subscription-Plänen
  • • Individual (0 $), Google AI Pro und Google AI Ultra stehen auf der Preisseite ohne explizite Preise — die Pro/Ultra-Beträge stammen aus den Google-AI-Pro/Ultra-Abonnements
  • • Ersetzt Gemini Code Assist Free-Tier (eingestellt am 18. Juni 2026)
Google Gemini Code Assist

Google Gemini Code Assist

Aktualisiert: 2026-10-05

US
Free
$0/Monat
Kostenloser Individual-Tier, 1.000 Modell-Anfragen/Tag geteilt CLI + Agent-Modus
StandardBeliebt
$22.8/Monat
$19/Monat jährlich
1.500 Modell-Anfragen/Tag, Enterprise-Features
Enterprise
$54/Monat
$45/Monat jährlich
2.000 Modell-Anfragen/Tag, Custom Code Context

LLM Modelle (7)

Gemini-3.1-ProGemini-3-ProGemini-2.5-ProGemini-3.5-FlashGemini-3-FlashGemini-2.5-FlashGemini-2.0-Flash

Features

  • IDE-Integration
  • Code-Vervollständigungen
  • Agent-Modus
  • GitHub PR-Review
  • MCP-Unterstützung
  • 1M Kontext
  • Firebase-Integration
  • Cloud SQL-Assistenz
  • BigQuery-Insights
  • IP-Schadlosstellung

Hinweise

  • • Free-Individual-Tier (0$) wird aktiv vermarktet; 1.000 Modell-Anfragen/Tag geteilt CLI + Agent-Modus (6.000 code-related + 240 Chat-Anfragen/Tag)
  • • Standard: 19$/Monat (jährlich) oder 22,80$/Monat
  • • Enterprise: 45$/Monat (jährlich) oder 54$/Monat
  • • Gemini 3-Zugriff jetzt in allen drei Tarifen enthalten (Free, Standard, Enterprise) — die Warteliste/Preview-Staging-Phase ist vorbei (3. Okt 2026)
  • • Google Developer Program-Mitgliedschaften bündeln die Tarife: Standardmitgliedschaft kostenlos, Premium 299$/Jahr inklusive Gemini Code Assist Standard plus über 1.000$ Google-Cloud-Credits, Enterprise 75$/Entwickler/Monat inklusive Enterprise
  • • Cloud Shell Editor: 50 Stunden/Woche kostenlos
  • • Cloud-Lizenzierung pro Stunde: Standard 0,0312$ (monatliche Bindung) bzw. 0,0260$ (12 Monate), Enterprise 0,0740$ bzw. 0,0616$; Lizenzgebühren werden monatlich abgerechnet
  • • Enterprise ergänzt Code-Customization, Gemini in Apigee, Gemini in Application Integration, zusätzliche Cloud-Assist-Features und erhöhte Agent-Nutzung; Cloud-Assist-Features sind in der Preview ohne Aufpreis enthalten
  • • Free-Individual-Tier durch Google Antigravity abgelöst (18. Juni 2026) für neue Developer-Onboarding; bestehende Nutzer behalten Zugriff
Hugging Face

Hugging Face

Aktualisiert: 2026-10-05

US
Free
$0/Monat
$0
PRO
$9/Monat
10x privater Speicher, 2x öffentlicher Speicher, 20x Inferenz-Credits, 8x ZeroGPU
TeamBeliebt
$20/Monat
SSO, Speicherregionen, Audit-Logs
Enterprise
$50/Monat
SCIM, höchste Limits, verwaltete Abrechnung, dedizierter Support

LLM Modelle (18)

DeepSeek-V4-ProDeepSeek-V4-FlashDeepSeek-V4.1-FlashGLM-5GLM-5.1GLM-5.3GLM-5.3-FlashKimi-K2.5Kimi-K2.6Kimi-K2.7-CodeKimi-K3MiniMax-M2.7MiniMax-M3Qwen3.8-2.4T-A95BLlama-3.3-70BGPT-OSS-120BQwen3-CoderLlama-3.1-8B-Instruct

Features

  • Spaces GPU
  • Inference Endpoints
  • Model-Hub

Hinweise

  • • Kostenlos, Pro 9$/Monat (10x privater Speicher, 2x öffentlicher Speicher, 20x Inferenz-Credits, 8x ZeroGPU), Team 20$/Benutzer/Monat (SSO, Speicherregionen, Audit-Logs), Enterprise 50$/Benutzer/Monat (SCIM, höchste Limits, verwaltete Abrechnung, dedizierter Support).
  • • Inference Providers: Agents (OpenCode, Codex, Hermes Agent, Pi, Claude Code, Cline) rufen Provider über den OpenAI-kompatiblen Router zu Providerkosten ohne Aufschlag auf — ein API-Key, Nutzung im Hub einsehbar.
  • • Doku (Sep. 2026): Die Agent-Quick-Setup-Guides nennen OpenCode, Pi, Codex, Claude Code, Hermes Agent; die Partner-Tabelle führt HF Inference zusätzlich zu Baseten, Cerebras, Cohere, DeepInfra, Fal AI, Featherless AI, Fireworks, Groq, Novita, Nscale, OVHcloud AI Endpoints, Public AI, Replicate, Scaleway, Together, WaveSpeedAI, Z.ai. Modellauswahl über Suffixe :fastest, :cheapest, :preferred bzw. :provider; /v1/models liefert Preise, Kontextlänge, Latenz und Durchsatz pro Provider.
  • • Monatliche Inference-Providers-Credits (Doku docs/inference-providers/pricing, am 2. Okt. 2026 geprüft): Free 0,10 $ (Änderung vorbehalten), PRO 2,00 $, Team/Enterprise 2,00 $ pro Seat. Es sind allgemeine Compute-Credits — über die Inference Providers hinaus nutzbar für Inference Endpoints, aufgerüstete CPU-/GPU-Hardware für Spaces (inkl. ZeroGPU-Nutzung über dem Kontingent) und Jobs; sie werden monatlich gutgeschrieben und vor jeder Pay-as-you-go-Abrechnung angerechnet. Anfragen mit einem eigenen Custom-Provider-Key verbrauchen die monatlichen Credits nicht; Team-/Enterprise-Credits werden organisationsweit geteilt und die Anfragen müssen die abgerechnete Organisation explizit benennen.
iFlytek

iFlytek

Aktualisiert: 2026-10-05

CN
Worry-FreeEingestellt
$0.56 Erster Monat
$2.71/Monat
Unbegrenzte Anfragen — EINGESTELLT in v2.2
ProfessionalEingestellt
$5.57/Monat
~1.200 Anfragen/5h, ~9.000/Woche, ~18.000/Monat — EINGESTELLT in v2.3
EfficientBeliebt
$28.43/Monat
~6.000 Anfragen/5h, ~45.000/Woche, ~90.000/Monat. Quartal: ¥538/Quartal
Express
$99.86 Erster Monat
$142.71/Monat
~30.000 Anfragen/Monat, Prioritätswarteschlange. Erster Monat ¥699, dann ¥999/Monat. Quartal: ¥2997/Quartal (Aktionspreis ¥2697)

LLM Modelle (20)

AutoAstron-Code-LatestSpark-X2-AgentSpark-X2-FlashSpark X2GLM-5.2GLM-5.1GLM-5GLM-4.7-FlashDeepSeek-V4-ProDeepSeek-V4-FlashDeepSeek-V3.2Kimi-K2.7-CodeKimi-K2.6Kimi-K2.5MiniMax-M2.5Qwen3.6-35B-A3BQwen3.5-397B-A17BQwen3.5-35B-A3BQwen3-Coder-Next-FP8

Features

  • Multi-Provider-Modelle
  • Einheitliche Modell-ID: astron-code-latest
  • Anfragenbasierte Pläne (v2.3)
  • Gleitendes 5-Stunden-, Wochen- und Monats-Limit
  • Spark X2 Agent natives Modell
  • Auto-Smart-Routing

Hinweise

  • • Dokumentversion v2.3, zuletzt aktualisiert 22.07.2026; Stufe Express (速通版) seit 23.07.2026
  • • Worry-Free (¥19) in v2.2 eingestellt
  • • Professional (¥39/Monat) in v2.3 eingestellt: ~1.200 Anfragen/5h, ~9.000/Woche, ~18.000/Monat
  • • Efficient: ~6.000 Anfragen/5h, ~45.000/Woche, ~90.000/Monat, ¥199/Monat
  • • Flusskontrolle nach Anfragezahl: gleitendes 5-Stunden-Fenster (1h Schritt), Woche zurück um 08:00 UTC+8, Abo-Monat = 31 Tage ab Zahlung
  • • Neu in v2.2/v2.3: Spark X2 Agent, Auto-Smart-Routing, GLM-5.2, Kimi-K2.7-Code
  • • Vierteljährliche Abrechnung verfügbar (¥538/Quartal Efficient, ¥2997/Quartal Express)
  • • Modell-Kostenkoeffizienten (seit 23.07.2026): 5x GLM-5.2/DeepSeek-V4-Pro/Kimi-K2.7-Code, 4x GLM-5.1/Kimi-K2.6, 3x GLM-5/Kimi-K2.5, 2x Spark-X2-Agent/Spark X2/Auto/DeepSeek-V4-Flash/DeepSeek-V3.2/MiniMax-M2.5/Qwen3.5-397B-A17B, 1x Spark-X2-Flash/GLM-4.7-Flash/Qwen3.6-35B-A3B/Qwen3.5-35B-A3B/Qwen3-Coder-Next-FP8
  • • Off-Peak-Koeffizient: 0,8× in Nächten/Wochenenden/Feiertagen (erhöht das effektive 5-Stunden-Limit, z.B. 6.000 → 7.500 Anfragen)
  • • Express-Anfragen werden separat gezählt ("速通"-Kontingent), um Warteschlangen und Timeouts in Spitzenzeiten zu umgehen
  • • Verbrauch pro Modellaufruf: einfache Aufgabe ~3-10 Aufrufe, komplexe Aufgabe ~10-30+
  • • Kontingent nur für interaktives Codieren in Coding-Tools (Claude Code, OpenCode, Cursor, OpenClaw) — keine Automatisierungsskripte, Batch-Aufgaben oder selbst gebauten Backends; Verstöße können zu Rate-Limits, Kündigung oder Accountsperrung führen
  • • Modelle: Spark X2 Agent, Spark X2, GLM-5.2/5.1/5/4.7-Flash, DeepSeek-V4-Pro/Flash/V3.2, Kimi-K2.7-Code/K2.6/K2.5, MiniMax-M2.5, Qwen3.6-35B-A3B, Qwen3.5-397B-A17B/35B-A3B, Qwen3-Coder-Next-FP8
  • • API: OpenAI- und Anthropic-kompatible Endpunkte
  • • Am 5.10.2026 geprüft: Doku weiterhin v2.3 (Stand 22.07.2026) — Efficient 199¥/Monat (538¥/Quartal), Express 999¥/Monat (2997¥/Quartal, erster Monat 699¥), die eingestellten Stufen Worry-Free/Professional, die Anfragekontingente, die 5x/4x/3x/2x/1x-Modellkoeffizienten und alle 20 Modell-IDs unverändert. maas.xfyun.cn/packageSubscription liefert eine leere SPA-Hülle (Headless-Render zeigt nur die Login-Seite), Preise daher aus der Doku
  • • Registrierung erfordert wahrscheinlich eine chinesische Festland-Rufnummer (+86)
iFlytek Astron

iFlytek Astron

Aktualisiert: 2026-10-05

CN
Worry-FreeEingestellt
$0.56 Erster Monat
$2.71/Monat
Unbegrenzte Anfragen — EINGESTELLT in v2.2
ProfessionalEingestellt
$5.57/Monat
~1.200 Anfragen/5h, ~9.000/Woche, ~18.000/Monat — EINGESTELLT in v2.3
EfficientBeliebt
$28.43/Monat
~6.000 Anfragen/5h, ~45.000/Woche, ~90.000/Monat. Quartal: ¥538/Quartal
Express
$99.86 Erster Monat
$142.71/Monat
~30.000 Anfragen/Monat, Prioritätswarteschlange. Erster Monat ¥699, dann ¥999/Monat. Quartal: ¥2997/Quartal (Aktionspreis ¥2697)

LLM Modelle (20)

AutoAstron-Code-LatestSpark-X2-AgentSpark-X2-FlashSpark X2GLM-5.2GLM-5.1GLM-5GLM-4.7-FlashDeepSeek-V4-ProDeepSeek-V4-FlashDeepSeek-V3.2Kimi-K2.7-CodeKimi-K2.6Kimi-K2.5MiniMax-M2.5Qwen3.6-35B-A3BQwen3.5-397B-A17BQwen3.5-35B-A3BQwen3-Coder-Next-FP8

Features

  • Multi-Provider-Modelle
  • Einheitliche Modell-ID: astron-code-latest
  • Anfragenbasierte Pläne (v2.3)
  • Gleitendes 5-Stunden-, Wochen- und Monats-Limit
  • Spark X2 Agent natives Modell
  • Auto-Smart-Routing

Hinweise

  • • Dokumentversion v2.3, zuletzt aktualisiert 22.07.2026; Stufe Express (速通版) seit 23.07.2026
  • • Worry-Free (¥19) in v2.2 eingestellt
  • • Professional (¥39/Monat) in v2.3 eingestellt: ~1.200 Anfragen/5h, ~9.000/Woche, ~18.000/Monat
  • • Efficient: ~6.000 Anfragen/5h, ~45.000/Woche, ~90.000/Monat, ¥199/Monat
  • • Flusskontrolle nach Anfragezahl: gleitendes 5-Stunden-Fenster (1h Schritt), Woche zurück um 08:00 UTC+8, Abo-Monat = 31 Tage ab Zahlung
  • • Neu in v2.2/v2.3: Spark X2 Agent, Auto-Smart-Routing, GLM-5.2, Kimi-K2.7-Code
  • • Vierteljährliche Abrechnung verfügbar (¥538/Quartal Efficient, ¥2997/Quartal Express)
  • • Modell-Kostenkoeffizienten (seit 23.07.2026): 5x GLM-5.2/DeepSeek-V4-Pro/Kimi-K2.7-Code, 4x GLM-5.1/Kimi-K2.6, 3x GLM-5/Kimi-K2.5, 2x Spark-X2-Agent/Spark X2/Auto/DeepSeek-V4-Flash/DeepSeek-V3.2/MiniMax-M2.5/Qwen3.5-397B-A17B, 1x Spark-X2-Flash/GLM-4.7-Flash/Qwen3.6-35B-A3B/Qwen3.5-35B-A3B/Qwen3-Coder-Next-FP8
  • • Off-Peak-Koeffizient: 0,8× in Nächten/Wochenenden/Feiertagen (erhöht das effektive 5-Stunden-Limit, z.B. 6.000 → 7.500 Anfragen)
  • • Express-Anfragen werden separat gezählt ("速通"-Kontingent), um Warteschlangen und Timeouts in Spitzenzeiten zu umgehen
  • • Verbrauch pro Modellaufruf: einfache Aufgabe ~3-10 Aufrufe, komplexe Aufgabe ~10-30+
  • • Kontingent nur für interaktives Codieren in Coding-Tools (Claude Code, OpenCode, Cursor, OpenClaw) — keine Automatisierungsskripte, Batch-Aufgaben oder selbst gebauten Backends; Verstöße können zu Rate-Limits, Kündigung oder Accountsperrung führen
  • • Modelle: Spark X2 Agent, Spark X2, GLM-5.2/5.1/5/4.7-Flash, DeepSeek-V4-Pro/Flash/V3.2, Kimi-K2.7-Code/K2.6/K2.5, MiniMax-M2.5, Qwen3.6-35B-A3B, Qwen3.5-397B-A17B/35B-A3B, Qwen3-Coder-Next-FP8
  • • API: OpenAI- und Anthropic-kompatible Endpunkte
  • • Am 5.10.2026 geprüft: Doku weiterhin v2.3 (Stand 22.07.2026) — Efficient 199¥/Monat (538¥/Quartal), Express 999¥/Monat (2997¥/Quartal, erster Monat 699¥), die eingestellten Stufen Worry-Free/Professional, die Anfragekontingente, die 5x/4x/3x/2x/1x-Modellkoeffizienten und alle 20 Modell-IDs unverändert. maas.xfyun.cn/packageSubscription liefert eine leere SPA-Hülle (Headless-Render zeigt nur die Login-Seite), Preise daher aus der Doku
  • • Registrierung erfordert wahrscheinlich eine chinesische Festland-Rufnummer (+86)
Infini-AI

Infini-AI

Aktualisiert: 2026-10-04

CN
LiteEingestellt
$6/Monat
1.0K Anfragen/5h6.0K Anfragen/Woche12.0K Anfragen/Monat
1,000 Anfragen/5h, 6,000/Woche, 12,000/Monat
ProBeliebtEingestellt
$28/Monat
5.0K Anfragen/5h30.0K Anfragen/Woche60.0K Anfragen/Monat
5,000 Anfragen/5h, 30,000/Woche, 60,000/Monat

LLM Modelle (9)

DeepSeek-V3.2DeepSeek-V3.2-ThinkingKimi-K2.5MiniMax-M2.1MiniMax-M2.5MiniMax-M2.7GLM-4.7GLM-5GLM-5.1

Features

  • Multi-Provider-Modellzugang
  • Feste monatliche Anfragekontingente
  • Wöchentliche und 5-Stunden-Grenzen
  • GLM-5.1-Unterstützung hinzugefügt

Hinweise

  • • Am 4.10.2026 geprüft: /gen-studio-coding-plan/ und /gen-studio/coding-plan/ liefern weiterhin 404; die Doku-Sitemap listet nur Coding-Tools-Integrationen (Claude Code, Cursor, Cline, OpenCode, Copilot CLI, Kimi Code, MiMo Code, Factory Droid, OpenClaw, Reasonix) — keine Coding-Plan-Seite. Der zwischengespeicherte Changelog bestätigt die Abschaltung zum 26.06.2026 mit erzwungenen Abbestellungen und Vollrückerstattung (inkl. ungenutzter Perioden) ab 27.06.2026 00:00
  • • Infini-AI hat zusätzlich die Privatkunden plattformweit abgeschaltet (nur noch Enterprise); die Pay-per-Token-GenStudio-API läuft weiter
  • • Infini Coding Lite ¥40/Monat (1.000 Anf./5h, 6.000 Anf./Woche), Pro ¥200/Monat (5.000 Anf./5h, 30.000 Anf./Woche)
  • • DeepSeek, MiniMax, Kimi, GLM Modelle
  • • Lite: 1.000 Anfragen/5h, 6.000/Woche, 12.000/Monat
  • • Pro: 5.000 Anfragen/5h, 30.000/Woche, 60.000/Monat
  • • GLM-5.1-Unterstützung am 9. April 2026 hinzugefügt
  • • Registrierung erfordert wahrscheinlich eine chinesische Festland-Rufnummer (+86)
JD Cloud

JD Cloud

Aktualisiert: 2026-10-04

CN
LiteEingestellt
$1.13 Erster Monat
$6/Monat
1.2K Anfragen/5h9.0K Anfragen/Woche18.0K Anfragen/Monat
Eingestellt: ~1.200 Anfragen/5h. War ¥40/Monat
ProEingestellt
$5.7 Erster Monat
$28/Monat
6.0K Anfragen/5h45.0K Anfragen/Woche90.0K Anfragen/Monat
Eingestellt: ~6.000 Anfragen/5h. War ¥200/Monat
TokenPlan Lite
$9.86/Monat
¥69/Monat, 17.250 Credits
TokenPlan Standard
$28.43/Monat
¥199/Monat, 49.750 Credits
TokenPlan ProBeliebt
$85.57/Monat
¥599/Monat, 149.750 Credits
TokenPlan Max
$142.71/Monat
¥999/Monat, 249.750 Credits

LLM Modelle (8)

GLM-5.2GLM-5.1Kimi-K2.6MiniMax-M3DeepSeek-V4-Pro-0813DeepSeek-V4-Pro-PreviewDeepSeek-V4-Flash-0731DeepSeek-V4-Flash-Preview

Features

  • Multi-Provider-Modellzugang
  • Token-basierte Pläne (neu)
  • Hohe Anfragekontingente

Hinweise

  • • CodingPlan ab 29.07.2026 für Neukäufe/Verlängerungen/Upgrades eingestellt. Bestehende Pläne bis Ablauf gültig
  • • TokenPlan ist der Ersatz: Lite ¥69, Standard ¥199, Pro ¥599, Max ¥999 pro Monat (privat)
  • • Enterprise-Sitze (auf Einladung, max. 50 Sitze): ¥207/597/1797/2997 pro Monat, 34.500/99.500/299.500/499.500 Credits pro Sitz (genau 2× privat)
  • • Credit-Abzug = (Input-Tokens × Koeffizient + Output-Tokens × Koeffizient) / 10000
  • • TokenPlan-Flusskontrolle: Monat 100%, Woche 30%, 5h 10% der monatlichen Credits (5h gleitend ab der ersten Anfrage, Woche zurück Montag 00:00 CST, Monat zum Abrechnungszyklus-Tag). Wochen-/5h-Credits: Lite 5.175/1.725, Standard 14.925/4.975, Pro 44.925/14.975, Max 74.925/24.975
  • • Ratenlimit 60 RPM pro Sitz (darüber HTTP 429), keine Credit-Übertragung, 7 Tage Aufbewahrung/Grace-Period nach Ablauf, tägliches Kauflimit, 1 Stunde Upgrade-Abklingzeit, nur ein aktives Privat-Abo
  • • Doku-Modellübersicht (Produktübersicht, Stand 23.09.2026) markiert DeepSeek-V4-Pro und DeepSeek-V4-Flash als 已下线 — sie sind nicht im Modell-Array gelistet; Ersatz: DeepSeek-V4-Pro-0813/-Preview, DeepSeek-V4-Flash-0731/-Preview. MiniMax-M3 ist das einzige bildverständige Modell
  • • maas-token-latest ist ein Auto-Routing-Alias, kein festes Modell — leitet jede Anfrage an das empfohlene Modell weiter
  • • Kontextfenster: GLM-5.1 200K, GLM-5.2 1M, Kimi-K2.6 256K, MiniMax-M3 1M, DeepSeek-V4-Linie 1M
  • • Am 4.10.2026 geprüft (PackageOverview 02.09.2026, Preis-/Credits-Doku 23.09.2026): private TokenPlan-Preise 69/199/599/999¥, Credits 17.250/49.750/149.750/249.750, Enterprise-Sitze 207/597/1797/2997¥, die 8-Modell-Credits-Koeffiziententabelle und die eingestellten Lite/Pro-CodingPlan-Kontingente (1.200/6.000 pro 5h) unverändert
  • • Registrierung erfordert wahrscheinlich eine chinesische Festland-Rufnummer (+86)
JetBrains AI

JetBrains AI

Aktualisiert: 2026-10-04

US
AI Free
$0/Monat
3 AI-Credits/30 Tage, unbegrenzte Code-Vervollständigung, kontextbewusster Chat, lokale Modell-Unterstützung (Ollama, LM Studio)
AI ProBeliebt
$10/Monat
$8/Monat jährlich
10 AI-Credits/Monat, Junie Coding-Agent, Claude Agent, Codex-Agent, Top-up-Credits (1$/Credit)
AI Ultimate
$30/Monat
$25/Monat jährlich
35 AI-Credits/Monat (5$ Bonus gegenüber Plan-Preis), gleiche AI-Features wie Pro
AI Enterprise
$60/Monat
$60/Monat jährlich
Nur Organisationen via JetBrains-IDE-Services. Kontingent auf Ultimate-Niveau oder höher, Enterprise-Sicherheit, custom AI-Integrationen

LLM Modelle (28)

Claude Opus 5Claude Opus 4.8Claude Opus 4.7Claude Opus 4.6Claude Opus 4.5Claude Sonnet 5Claude Sonnet 4.6Claude Sonnet 4.5Claude Fable 5Claude Haiku 4.5GPT-5.6-SolGPT-5.6-TerraGPT-5.6-LunaGPT-5.5GPT-5.4GPT-5.3-CodexGPT-5.2GPT-5Gemini-3.1-ProGemini-3.6-FlashGemini-3.5-FlashGemini-3-FlashGemini-2.5-ProGemini-2.5-FlashGrok-4.3o3o4-miniGemini-3.1-Flash-Lite

Features

  • AI-Credits-System (1 Credit = 1$)
  • Top-up-Credits 12 Monate gültig
  • Junie autonomer Coding-Agent
  • Claude-Agent-SDK
  • Codex-Agent
  • BYOK für OpenAI, Anthropic, Google, xAI
  • Lokale Modelle (Ollama, LM Studio)
  • On-Prem-LLMs via Hugging Face

Hinweise

  • • AI Free: 3 Credits/30 Tage, unbegrenzte Code-Vervollständigung
  • • AI Pro: 10$/Monat Individual (10 Credits), 20$/Monat Organisation (20 Credits); jährlich 100€/Benutzer/Jahr Individual, 200€/Benutzer/Jahr Organisation
  • • AI Ultimate: 30$/Monat Individual (35 Credits), 60$/Monat Organisation (70 Credits); jährlich 300€/Benutzer/Jahr Individual, 600€/Benutzer/Jahr Organisation
  • • AI Enterprise: 720€/Benutzer/Jahr (60$/Monat), nur Organisationen, Kontingent auf Ultimate-Niveau oder höher
  • • 1 AI-Credit = 1,00$ USD, beliebige Top-ups, 12 Monate gültig
  • • Pricing-Seite standardmäßig mit Jahresabrechnung (2 Monate sparen); EUR-Anzeige für die EU
  • • Organisations-AI-Lizenzen werden auf geteilten AI-Credit-Pool via JetBrains Central umgestellt (AI Pro 20, AI Ultimate 70 Credits/Lizenz/Monat; All Products Pack und dotUltimate ebenfalls 20 Credits/Monat)
  • • JetBrains-Central-Pool-Credits sammeln sich monatlich an; gekaufte Top-up-Credits laufen nach 1 Jahr ab, aus Lizenzen umgewandelte am Ende des Lizenzmonats
  • • 30-tägige kostenlose Testphase von AI Pro für Nutzer mit kostenpflichtigen IDE-Lizenzen
  • • AI Trial: kostenlose 30-tägige Testphase von AI Pro (10 Individual / 20 Org Credits)
  • • Kosten pro Anfrage variieren (Beispiel: Gemini 3 Flash ~0,17 Credits, Claude Sonnet ~0,32, Claude Opus ~1,07); Chat, Code-Vervollständigung und lokale Modelle sind kostenlos
  • • JetBrains-Schätzung pro 1 AI-Credit: ~10 AI-Chat-Anfragen, ~40 Codeerzeugungs-Anfragen im Editor, ~25 Erklärungen markierten Codes, ~280 Doku-Erstellungen, ~140 Commit-Nachrichten
  • • Top-up-Credits sind in Mainland China nicht verfügbar; AI-Enterprise-Lizenzen können nicht aufgeladen werden
  • • All Products Pack enthält AI Pro (10 Individual / 20 Org Credits)
  • • Code-Vervollständigung ist kostenlos und verbraucht keine Credits
  • • Claude Agent, Codex und Junie sind in die IDE integriert
  • • Am 04.10.2026 erneut geprüft gegen help/ai-assistant/licensing-and-subscriptions.html (Rev. 22.07.2026) und help/ai-assistant/supported-llms.html (Rev. 06.08.2026) — Tarife, Credit-Kontingente und Modellkatalog unverändert. jetbrains.com/ai-ides/buy/ ist JS-gerendert und liefert dem Fetcher keine Plantexte; alle Stufenpreise und Credit-Kontingente stammen von der Licensing-Hilfeseite
Kilo Code

Kilo Code

Aktualisiert: 2026-10-04

US
Free
$0/Monat
Open Source VS Code/JetBrains/CLI-Extensions, agentic Coding-Assistent
Auto Free/BYOK
$0/Monat
Kostenlose Inferenz-Stufe. BYOK unterstützt. Leitet über Kilo Gateway zu kostenlosen Modellen
Kilo Gateway
Siehe Anbieter
Pay-as-you-go. Exakte Anbieterraten, 500+ Modelle, 60+ Anbieter. Keine Plattformgebühr
Kilo Pass StarterBeliebt
$19/Monat
Monatliches AI-Credit-Abo mit Bonus-Credits. Bis zu 26,60$/Monat in Credits
Kilo Pass Pro
$49/Monat
Höhere Credit-Stufe. Bis zu 68,60$/Monat in Credits
Kilo Pass Expert
$199/Monat
Intensive Nutzung. Bis zu 278,60$/Monat in Credits, max. Bonus bei 12-Monats-Streak
Teams
$15/Monat
15$/Benutzer/Monat. Nutzungsanalysen, AI-Adoption-Score, geteilte Agent-Modi, geteiltes BYOK, zentralisierte Abrechnung, Prio-Support
Enterprise
Siehe Anbieter
Individuelle Preise. SSO, Audit-Logs, SLA, Shared Private Gateway

LLM Modelle (9)

Claude Sonnet 4.6Claude Opus 4.8GPT-5.5GPT-5.3-CodexGemini-3.1-ProKimi-K3GLM-5.2Qwen3.7-PlusDeepSeek-V3.2

Features

  • 500+ Modelle von 60+ Anbietern
  • Open-Source VS Code/JetBrains/CLI
  • BYOK oder gehostete Inferenz
  • Kilo Pass mit bis zu 50% Bonus-Credits
  • Zentralisierte Team-Abrechnung (Teams)
  • Enterprise SSO & Private Gateway

Hinweise

  • • Free: Open-Source-Extensions + agentic Coding-Assistent. Auto Free/BYOK: $0. Kilo Gateway: Pay-as-you-go zu Anbieterraten
  • • Kilo Code wurde von Anaconda übernommen. Der Kilo Marketplace ermöglicht den Kauf von Partner-Coding-/Inferenz-Plänen mit Kilo Credits
  • • Kilo Pass: Starter 19$/Monat, Pro 49$/Monat, Expert 199$/Monat — Bonus-Credits steigen mit Stufe. Jahresoption: 588$/Jahr (50% Bonus, Gesamtwert 776,65$ = 32% extra über 12 Monate)
  • • Teams 15$/Benutzer/Monat (Nutzungsanalysen, AI-Adoption-Score, geteilte Agent-Modi, geteiltes BYOK, Jira- & Bitbucket-Integrationen, Prio-Support). Enterprise: custom (SSO, Audit-Logs, SLA, 14-tägige Testversion)
  • • Credit-Kauf-Verarbeitungsgebühr: 5%. 14-tägige Enterprise-Testversion
  • • Cloud-Compute sekundengenau abgerechnet: Gas Town 1,20$/h, Code Review 0,33$/h, Cloud Agents 0,60–1,20$/h
  • • Am 04.10.2026 erneut geprüft gegen kilo.ai/pricing — Kilo-Pass-Stufen (Starter 19$, Pro 49$, Expert 199$), 588$/Jahr (50% Bonus, Gesamtwert 776,65$), Teams 15$/Benutzer/Monat, 5% Bearbeitungsgebühr und alle Cloud-Compute-Raten unverändert
Kimi Code

Kimi Code

Aktualisiert: 2026-10-05

CN
Adagio Free
$0/Monat
0$. 1 parallele Agent-Task, 4x Prioritäts-Warteschlange, 2 geplante + 2 Widget-Aufgaben, 2 Projekte / 500MB Speicher, 15+ Plugin-Typen, Swarm mit 2 Subtasks, kein Goal Mode, Kimi Code nicht enthalten
PlusBeliebt
$15/Monat
$15/Monat jährlich
15$/Monat (Listenpreis 19$; Jahresabo 180$). Mehr Agent-Credits, Docs/Sheets/PPT, Deep Research, Website-Deployment, Agent-Multitasking (2 parallele Tasks), Swarm (2 Subtasks), geplante Aufgaben (10), Projekte (20) & 20GB Speicher
Pro
$31/Monat
$31/Monat jährlich
31$/Monat (Listenpreis 39$; Jahresabo 372$). 2x Agent-Credits, Goal Mode, Ein-Klick-Kimi-Claw-Deployment, Kimi Code, Swarm (4 Subtasks), geplante Aufgaben (15), Projekte (20) & 20GB Speicher
Max
$79/Monat
$79/Monat jährlich
79$/Monat (Listenpreis 99$; Jahresabo 948$). 5x Agent-Credits, K3 1M Kontext, Goal Mode, Kimi Code, 2 parallele Agent-Tasks, geplante Aufgaben (20), Projekte (100) & 50GB Speicher
Ultra
$159/Monat
$159/Monat jährlich
159$/Monat (Listenpreis 199$; Jahresabo 1.908$). 10x Agent-Credits, K3 1M Kontext, Goal Mode, max. Concurrency (4 Tasks), Kimi Code, geplante Aufgaben (25), Projekte (100) & 50GB Speicher

LLM Modelle (3)

Kimi-K3Kimi-K2.7-CodeKimi-K2.6

Features

  • Vision-Unterstützung
  • Tiefenrecherche
  • Agent-Swarm
  • Kimi Claw
  • Kimi-K3 Flaggschiff
  • Geteilter Credit-Pool für alle Features
  • Kimi Code separates 5h/Woche-Limit

Hinweise

  • • Parallele Agent-Tasks: Adagio 1, Plus 2, Pro 2, Max 2, Ultra 4. Swarm-Subtasks: 2/4/8/8. Goal Mode ab Pro, Max und Ultra
  • • International (intl USD): kimi.ai/membership/pricing und kimi.com/membership/pricing zeigen beide das neu aufgelegte Membership mit den Stufen Plus 15$/Monat (Listenpreis 19$, Jahresabo 180$=15$/Monat) / Pro 31$/39$ (Jahr 372$) / Max 79$/99$ (Jahr 948$) / Ultra 159$/199$ (Jahr 1.908$) (Banner "The new membership plan is now available"); die alten Stufennamen Moderato/Allegretto/Allegro/Vivace sind eingestellt
  • • China-Markt (kimi.com, CNY; Help-Center-Doku): Andante 49¥/Monat, Moderato 99¥/Monat, Allegretto 199¥/Monat, Allegro 699¥/Monat (jährlich spart bis zu 1.680¥). Agent-Nutzungen ≈30/60/150/360 pro Monat; CN-Lineup hat keine Vivace-Stufe
  • • CN-Stufen-Leistungen (Help-Center): Andante ~30 Agent-Nutzungen, 6 Widget- + 6 geplante Aufgaben, 1.000 DB-Aufrufe, 20 Projekte/20GB · Moderato ~60 Nutzungen, 2 parallele Tasks, 25 Swarm-Nutzungen (2 Subtasks), 10+10 Aufgaben, 2.000 DB-Aufrufe · Allegretto ~150 Nutzungen, 2 parallel, 50 Swarm (4 Subtasks), Goal Mode, 15+15 Aufgaben, 5.000 DB-Aufrufe · Allegro ~360 Nutzungen, 4 parallel, 120 Swarm (8 Subtasks), Millionen-Token-Konversationen, 20+20 Aufgaben, 100 Projekte/50GB, 12.000 DB-Aufrufe
  • • Alle Paid-Pläne enthalten Kimi- und Kimi-Code-Vorteile mit einem gemeinsamen Credit-Pool
  • • Kimi Code hat ein separates 5h/Woche-Limit (betrifft nur Kimi Code, nicht andere Features)
  • • Kimi-K3 ist das aktuelle Flaggschiff (veröffentlicht am 16. Juli 2026); 1M Kontext ab Max und Ultra
  • • Kimi-K2.6 über den Chat-Einstieg verbraucht Credits aus dem Mitgliedschafts-Credit-Pool (nicht kostenlos)
  • • Unverbrauchte Credits verfallen am Ende jedes Abrechnungszyklus; monatliche Aktualisierung
  • • Kimi-Claw-Cloud-Sandboxen kosten ~0,6% Credits/Tag; veröffentlichte Agent-Websites ~0,08% (Abzug um 16 Uhr, kimi.com Help-Center)
  • • Auch über den Alibaba Coding Plan verfügbar
  • • Installation: curl -L code.kimi.com/install.sh | bash
  • • Internationale Plattform kimi.com/code + platform.kimi.ai (kein +86). China: platform.moonshot.cn (erfordert +86)
Kiro

Kiro

Aktualisiert: 2026-10-04

US
Free
$0/Monat
50 Credits/Monat, Claude Sonnet 4.5 + Open-Weight-Modelle (Qwen3 Coder Next, DeepSeek-V3.2, MiniMax-M2.1)
ProBeliebt
$20/Monat
1.000 Credits/Monat, Premium-Modelle, 0,04$/Credit Überschreitung, 20$ Anmeldebonus
Pro+
$40/Monat
2.000 Credits/Monat, Premium-Modelle, 0,04$/Credit Überschreitung
Pro Max
$100/Monat
5.000 Credits/Monat, Premium-Modelle, 0,04$/Credit Überschreitung
Power
$200/Monat
10.000 Credits/Monat, Premium-Modelle, 0,04$/Credit Überschreitung

LLM Modelle (22)

Claude Opus 5.5Claude Opus 5Claude Opus 4.8Claude Opus 4.7Claude Opus 4.6Claude Opus 4.5Claude Fable 5.1Claude-Sonnet-5.5Claude Sonnet 5Claude Sonnet 4.6Claude Sonnet 4.5Claude Sonnet 4.0AutoClaude Haiku 4.5GPT-5.6-SolGPT-5.6-TerraGPT-5.6-LunaQwen3-Coder-NextDeepSeek-V3.2GLM-5MiniMax-M2.5MiniMax-M2.1

Features

  • Spec-getriebene Entwicklung
  • Auto-Modus (Mix aus Frontier-Modellen)
  • Vibe-Modus + Spec-Modus
  • Kiro Web (cloud-basiert)
  • Kiro Crew (Multi-Agent)
  • Kiro Powers (Skills/Erweiterungen)
  • Agent-Hooks
  • Pay-per-Use-Überschreitung (0,04$/Credit)
  • AWS GovCloud-Verfügbarkeit

Hinweise

  • • Kostenlos (50 Credits), Pro 20$/Monat (1.000 Credits), Pro+ 40$ (2.000), Pro Max 100$ (5.000), Power 200$ (10.000). 0,04$/Credit Überschreitung.
  • • 20$ Anmeldebonus beim ersten Upgrade auf einen bezahlten Kiro-Tarif (Social Login oder AWS Builder ID)
  • • Credit-Multiplikatoren (vs. Auto 1,0×): Claude Fable 5.1 6× (Enterprise-Preview, nur US East), Claude Opus 5.5 2,0×, Claude Opus 5/4.8/4.7/4.6/4.5 2,2×, Claude Sonnet 5.5/5/4.6/4.5/4.0 1,3×, Haiku 4.5 0,4×, GLM-5 0,5×, MiniMax M2.5 0,25×, M2.1 0,15×, DeepSeek 3.2 0,25×, Qwen3 Coder Next 0,05×; GPT-5.6 Sol 4,4× / Terra 2,2× / Luna 1,1× (2× über 272K-Kurzlimit)
  • • Free-Tier: 50 Credits, nur Open-Weight-Modelle + Claude Sonnet 4.5. GovCloud: ~20% höhere Preise, kein Free-Tier
  • • Add-on-Credit-Pakete von 5$ (125 Credits) bis 100$, sofort abgerechnet; ungenutzte Add-on-Credits werden übertragen und laufen nach 12 Monaten ab. Monats-Credits werden nicht übertragen
  • • Enterprise: Admins können 0,04$/Credit-Überschreitungen aktivieren (standardmäßig aus, monatliche Abrechnung); Kiro Web verbraucht dieselben Credits auf jeder Oberfläche (keine extra Cloud-Compute-Gebühr)
  • • Am 04.10.2026 erneut geprüft gegen kiro.dev/pricing und kiro.dev/docs/models (Seite aktualisiert am 02.10.2026) — alle fünf Stufen, 0,04$/Credit-Überschreitung und Add-on-Pakete unverändert; NEU: Claude Sonnet 5.5 (1M Kontext, 1,3× Credits, US/EU) im Katalog ergänzt — Kiro positioniert ihn als >30% schneller bei der Ausgabe als Sonnet 5, für Scoped-Coding, Reviews und Sub-Agents
KwaiKAT

KwaiKAT

Aktualisiert: 2026-10-05

CN
MiniEingestellt
$5/Monat
$4/Monat jährlich
~40 Prompts pro 5h
Einstieg für Erstnutzer
StarterEingestellt
$10/Monat
$8/Monat jährlich
~100 Prompts pro 5h
Tägliche Kernentwicklung
ProBeliebtEingestellt
$20/Monat
$17/Monat jährlich
~300 Prompts pro 5h
3× Starter-Nutzung
MaxEingestellt
$50/Monat
$42/Monat jährlich
~1.0K Prompts pro 5h
3× Pro-Nutzung

LLM Modelle (4)

KAT-Coder-Pro-V2.5KAT-Coder-Air-V2.5KAT-Coder-Pro-V2KAT-Coder-Pro-V1

Features

  • Dateiübergreifendes Verständnis
  • Repository-weite Analyse
  • KAT-Coder-Pro-V2.5: Neuestes Frontier-Modell
  • KAT-Coder-Pro-V2: Agentische Aufgaben (89,5% τ²-Bench)

Hinweise

  • • 1 Prompt ≈ 15-20 Modellaufrufe
  • • 60 RPM / 2M TPM Rate-Limit
  • • 5-Stunden-Quota mit festem Fenster
  • • API: wanqing.streamlakeapi.com (China), vanchin.streamlake.ai (Übersee)
  • • Coding Plan nicht mehr erhältlich (Marketing-Seite am 5. Okt 2026 erneut 404; Doku-Preisseite zeigt leeren Coding-Plan-Abschnitt, PAYG-Doku listet jetzt Qwen-, DeepSeek-, GLM-, Kimi-, MiniMax- und MiMo-Modelle, keine KAT-Coder-Zeilen)
  • • KAT-Coder-Modellfamilie am 31. Aug 2026 eingestellt (API 410 model_retired)
  • • KAT-Coder-Pro-V2.5: 0,74$/2,96$ pro Mio. Tokens (PAYG)
  • • KAT-Coder-Air-V2.5: 0,15$/0,60$ pro Mio. Tokens (PAYG)
  • • KAT-Coder-Pro-V2: 0,30$/1,20$ pro Mio. Tokens (PAYG; Cache-Read 0,06$)
  • • KAT-Coder-Pro-V1: 0,30$/1,20$ pro Mio. Tokens (PAYG; Cache-Read 0,06$)
  • • Prepaid-Ressourcenpakete seit 5. Januar 2026 offline
  • • Übersee-Plattform vanchin.streamlake.ai (Google-OAuth, kein +86). China: wanqing.streamlakeapi.com (erfordert +86)
Lovable

Lovable

Aktualisiert: 2026-10-05

SE
Free
$0/Monat
Täglicher Grant von 5 Build-Credits (max. 30/Monat), 20 Cloud-Credits/Monat, 4 AI-Gateway-Credits/Monat, tägliche Chat-Allowance, Workspace-private Projekte, unbegrenzte Mitglieder, 5 lovable.app-Domains
ProBeliebt
$25/Monat
$21/Monat jährlich
25$/Monat (21$/Monat jährlich). 100 Pro-Credits/Monat, inkl. Free-Grants, Credit-Rollover, Nachkäufe für 15$ je 50 Credits (0,30$/Credit), unbegrenzte lovable.app-Domains, Custom Domains, Rollen & Rechte, Pro-Mitglied-Limits, Design-Systeme
Business
$50/Monat
$42/Monat jährlich
50$/Monat (42$/Monat jährlich). 100 Business-Credits/Monat, alles aus Pro plus Team-Workspace, rollenbasierter Zugriff, internes Publizieren, SSO, Security Center, Design-Templates, Priority-Support, Nachkäufe für 30$ je 50 Credits (0,60$/Credit)
Enterprise
Siehe Anbieter
Plattformgebühr + volumebasierte Credit-Preise. Alles aus Business plus SCIM, Audit-Logs, Publish-/Invite-Beschränkung, Auto-Retire verwaister Apps, geplante Security-Scans, sensible Datenerkennung, Git-Sync Data Residency, GitHub Enterprise, private npm-Registry, benannter CSM, Custom SLA. Ohne tägliche Chat-Allowance

LLM Modelle (6)

GPT-5.6GPT-5.5GPT-5.4GPT-5.2Claude Sonnet 5Claude Sonnet 4.6

Features

  • KI-gestützter Web-App-Builder aus natürlicher Sprache
  • React + Supabase Full-Stack-Generierung
  • Live-Vorschau und Bearbeitung
  • One-Click-Deployment
  • Benutzerdefinierte Domains
  • GitHub-Sync (Code-Export)
  • Select & Edit-Modus
  • Team-Zusammenarbeit
  • Lovable-Cloud-Hosting
  • Branching-Unterstützung

Hinweise

  • • Preisseite am 05.10.2026 erneut verifiziert (Plan-Karten sind wieder JS-only — die Überschrift „Plans" rendert ohne Karteninhalt, die Preise bleiben also bei den zuletzt verifizierten Werten; die Jahrespreise sind weiterhin nur über den Toggle sichtbar): Free 0$, Pro 25$/Monat (21$/Monat jährlich, jährlich = 2 Monate gratis), Business 50$/Monat (42$/Monat jährlich), beide ab 100 Monats-Credits. Enterprise wird als „Platform fee“ + „Volume based pricing“ mit unbegrenzt vielen Nutzern gelistet. Karteninhalte unverändert ggü. 01.10.: Free (Workspace-private Projekte, unbegrenzte Mitwirkende, 5 lovable.app-Domains, Cloud, Community-Support), Pro (100 Pro-Credits, Free-Grants, Credit-Rollover von 1 Monat bei monatlichen Plänen bzw. bis einen Monat nach Ende des Jahresplans, Nachkäufe auf Abruf, unbegrenzte lovable.app-Domains, Custom Domains, Rollen & Rechte, Pro-Mitglied-Limits, Entfernen des Lovable-Badges, E-Mail-Support, Design-Systeme), Business (100 Business-Credits, Team-Workspace, rollenbasierter Zugriff, internes Publizieren, persönliche Projekte, SSO, Security Center, Design-Templates, Priority-Support), Enterprise (alles aus Business plus Directory-Sync SCIM, Audit-Logs, Publish-/Invite-Beschränkung, Auto-Retire verwaister Apps, geplante Security-Scans, sensible Datenerkennung und -kontrolle, erweiterte Design-System-Support, Git-Sync Data Residency, GitHub Enterprise Cloud oder selbst gehostet, private npm-Registry, benannter CSM inkl. Onboarding und Deployment, Custom SLA). Die am 02.10. notierte europäische Bruttopreis-Anzeige (€0 / €25 / €50 inkl. MwSt.) wird in diesem Fetch nicht gerendert, das ist daher als Geo-/Locale-Effekt und nicht als bestätigte Änderung zu lesen. Neue FAQ-Einträge seit 01.10.: „Do you charge per seat or per user?“ (nein — unbegrenzte Mitglieder auf allen Plänen, die Preise richten sich nach Credits, nicht nach Sitzen), „Why is the Business plan more expensive?“ (die zusätzlichen Features; die Run- und AI-Kosten in Dollar sind identisch zu Pro, nur der Credit-Preis unterscheidet sich, daher sinkt bei Pro → Business die angezeigte Credit-Nutzung für dieselbe Arbeit) und „How much does it cost to run my app on Lovable?“ (Hosting ist meist vollständig durch den inkludierten Grant gedeckt; Apps mit relevantem Traffic oder Umfang ziehen danach aus dem Credit-Guthaben). „What is included in free and paid plans?“ ergänzt nun, dass manche regionalen Pläne die täglichen Build-Credits bei 30 pro Monat deckeln. Zwei weitere FAQ-Einträge erscheinen im Render vom 05.10.: „Do you offer a student discount?“ (ja, gültige Studenten-Mail, Beantragung über lovable.dev/students) und „Who owns the projects and code?“ (du selbst — vorbehaltlich Drittanbieter-Rechten an den zugrunde liegenden Modellen). Die Tabelle mit den Build-Kosten-Beispielen ist unverändert (0,50 / 0,90 / 1,20 / 1,70 für den Landingpage-Prompt). Studenten-Rabatt weiterhin bis zu 50% auf Lovable Pro; Lovable for Campus und Lovable for Kids (imagi) unverändert. Unveränderte FAQ-Einträge: Credit-Definitionen und -Nutzung, Credit-Ablauf (monatliche Plan-Credits 2 Monate, jährliche Plan-Credits 1 Monat nach Ende des Jahreszeitraums, Nachkäufe 12 Monate), was bei Ende des Abos passiert, Credits sind weder erstattbar noch einlösbar, und wie man Credits für ein Team/eine Klasse/Community kauft (ein Workspace = ein geteilter Credit-Pool, Pro-Mitglied-Limits mit Overrides).
  • • Build-Mode-Credit-Beispiele am 01.10.2026 erneut verifiziert (unverändert, die Abweichung 1,70 vs. 2,00 zwischen Pricing-FAQ und Credit-Doku besteht weiter): 0,50 (Button grau), 0,90 (Footer entfernen), 1,20 (Authentifizierung mit Sign-up und Login), und das Landingpage-Beispiel wird in der FAQ der Preisseite jetzt mit 1,70 geführt („Build me a landing page, use images" — Landingpage mit 3 generierten Bildern, Theme und 5 Sektionen), während die Credit-Doku für denselben Prompt weiterhin 2,00 nennt; die beiden Quellen widersprechen sich also. Exakte Kosten pro Nachricht sind in der Nachrichtenhistorie unter More options („Credits used") sichtbar. Credit-Nachkäufe unverändert: Pro 15$ pro 50 Credits (0,30$/Credit), Business 30$ pro 50 Credits (0,60$/Credit), einmalige Stripe-Zahlungen, 12 Monate gültig; Auto-Top-up standardmäßig 100 Credits bei 25-Credit-Schwelle mit 400-Credit-Monatslimit (Beträge 50–10.000, Limits bis 100.000 oder No limit) und pausiert beim Wechsel Pro → Business. Eine Balance deckt weiterhin fünf Nutzungstypen ab (Build, Chat, Cloud, AI-Gateway, Connector); Plan-Modus 1 Credit pro Nachricht plus Subagent-Recherche, Build-Modus 0,50–2,00 Credits je nach Komplexität.
  • • Chat-Preismodell am 05.10.2026 erneut verifiziert — auch die Lesart vom 03.10. hält nicht: Der Hinweis auf das befristete Angebot ist in der Credit-Doku wieder verschwunden. Weder „a temporary offering and subject to change“ noch „through October 31, 2026“ kommen im Render vom 05.10. vor, während Grant-Tabelle, Verbrauchsreihenfolge im Chat, Check-in-Stufe, Benachrichtigungen und Balance-Ansichten unverändert vorhanden sind. Da derselbe Wortlaut am 01.10. als entfernt, am 03.10. als vorhanden und am 05.10. wieder als entfernt gemeldet wurde, sollte das als Versions-Churn der Doku und nicht als Richtungsänderung gelesen werden und nach dem 31.10.2026 erneut geprüft werden. Der Rest der Credit-Doku ist unverändert und dokumentiert weiterhin das vollständige Verbrauchsverhalten (Chat zieht zuerst von der täglichen Chat-Allowance, dann von den täglichen Build-Credits, dann von den allgemeinen Credits; ist das Guthaben leer, stoppt das Bauen mit einem blockierenden Dialog, laufende Arbeit pausiert, KI-Features in deployten Apps stoppen und Cloud-Backend-Dienste pausieren, während Chats solange weiterlaufen, wie die tägliche Allowance reicht), die Liste Alerts and notifications und View your credit balance (Tabs Breakdown + History über 12 Monate, Commitment-Credits auf Enterprise, Converted-Balance-Eintrag aus der Umstellung auf eine einheitliche Balance) sowie die Umrechnungskurse für Altsalden Pro 0,25$ pro Credit und Business 0,50$ pro Credit. Neu dokumentiert im Oct-3-Snapshot (im Render vom 05.10. ist der Starthinweis zur Historie wieder nicht enthalten, die Angabe bleibt also zuletzt verifiziert): Die Aufzeichnung der Credit-Historie startete am 8. März 2026, frühe History-Tabs zeigen daher weniger als 12 Monate; Run-Credit-Nutzungshistorie existiert erst ab der Umstellung auf die einheitliche Balance (frühestens 1. Juni 2026) und neue Run-Nutzung kann bis zu 24 Stunden brauchen (Build-/Chat-Nutzung hinkt bis zu einer Minute hinterher); die Usage-details-Seite hat einen Group-Filter für Business und Enterprise; man kann Lovable im Projekt-Chat nach Credit-Nutzung, Plan und Abo fragen (Fragen zählen als Build-Nutzung, und Lovable kann antworten, aber den Plan nicht ändern); und der Enterprise-Dialog heißt „Credit history“ und zeigt nur die Historie ohne Breakdown-Tab.
  • • Credit-Doku am 01.10.2026 unverändert — Grants je Plan: Free = tägliche Chat-Allowance + 5 tägliche Build-Credits (max. 30/Monat) + 20 Cloud- + 4 AI-Credits pro Monat; Pro und Business = größere tägliche Chat-Allowance + 5 tägliche Build-Credits (ohne Monats-Cap) + 20 Cloud- + 4 AI-Credits pro Monat. Ablauf: tägliche Grants am Tagesende, monatlicher Cloud-/AI-Grant am Ende des Kalendermonats auf Free und am Ende des Abrechnungszyklus auf Pro/Business, monatliche Plan-Credits 2 Monate nach Ausgabe (monatlich) bzw. 1 Monat nach Ende der Jahresperiode, Rollover-Credits behalten ihr ursprüngliches Ablaufdatum, Nachkäufe 12 Monate, Referral-Credits 12 Monate. Rollover erfolgt automatisch, solange das Abo aktiv bleibt, und Lovable verbraucht die allgemeinen Credits mit dem frühesten Ablaufdatum zuerst. Connector-Requests mit „Managed by Lovable" (Perplexity, Firecrawl, Parallel) laufen über Credits, werden aber nicht von den Cloud-/AI-Grants gedeckt. Lange laufende Build-Mode-Nachrichten melden sich bei 20 Credits (Standard) — eine Benachrichtigungsschwelle, kein hartes Cap; konfigurierbar 20–100.000, Beta, eine einzelne Nachricht kann bis zu 10 Stunden laufen und mehrfach zurückfragen; /goal-Läufe kosten spürbar mehr; Drafts anlegen, aktualisieren, akzeptieren oder löschen ist kostenlos, eine Build-Mode-Nachricht im Draft kostet dasselbe wie im Hauptprojekt. Cloud-Nutzung gliedert sich in Datenbank, Netzwerk, Storage, Compute und Realtime; AI-Gateway-Nutzung wird pro Modellaufruf in deployten Apps gemessen.
MiniMax Token Plan

MiniMax Token Plan

Aktualisiert: 2026-10-05

CN
Free
$0/Monat
Eingeschränktes Textmodell (M3.1 Flash Preview) und eingeschränkte Bild- & Sprachmodelle. 5 geplante Aufgaben, 20 Website-Deployments, 20 Projekte. Kein API-Key für Coding-Tools, kein Videomodell
GoBeliebt
$11 Erster Monat
$22/Monat
$18/Monat jährlich
1700.0M Tokens/Monat
Für leichte Nutzung. Textmodelle, Bild- & Sprachmodelle, Websuche & multimodales Verstehen, MiniMax Code im Web/Desktop/TUI/iOS/Android, API-Key für AI-Agents und Coding-Tools. 5h gleitende & wöchentliche Quotas, 3-4 Agents. Erster Monat 50% Rabatt (11$), Angebot endet am 14. Oktober 2026
Explore
$27.5 Erster Monat
$55/Monat
$46/Monat jährlich
5100.0M Tokens/Monat
Für den Alltag. 3x Go-Nutzung plus H3-Videomodell. 5h gleitende & wöchentliche Quotas, 4-5 Agents. Erster Monat 50% Rabatt (27,50$), Angebot endet am 14. Oktober 2026
Build
$66 Erster Monat
$132/Monat
$110/Monat jährlich
12500.0M Tokens/Monat
Für intensive Nutzung. 7,5x Go-Nutzung plus H3-Videomodell, Prioritätszugriff in Stoßzeiten und früher Zugang zu neuen Features. 5h gleitende & wöchentliche Quotas, 6-7 Agents. Erster Monat 50% Rabatt (66$), Angebot endet am 14. Oktober 2026

LLM Modelle (3)

MiniMax-M3MiniMax-M3.1-Flash-PreviewMiniMax-M2.7

Features

  • Speech 2.8
  • Bildgenerierung Image-01
  • Hailuo-2.3 Video
  • Hailuo-2.3 Video-Quota (3 Clips/Tag Explore, 5/Tag Build)
  • Credits-System (5$=5k, 25$=25k, 100$=100k)

Hinweise

  • • Umbenannt zu "M Plan" (Okt 2026): Die Token-Plan-Stufen Plus/Max/Ultra wurden bei unveränderten Preisen (22$/55$/132$ pro Monat, 220$/550$/1.320$ pro Jahr) in Go/Explore/Build umbenannt und eine Free-Stufe ergänzt; platform.minimax.io/subscribe/token-plan zeigt die neuen Namen, während die Preis-Doku weiter Plus/Max/Ultra listet
  • • Erstmonats-Aktion: 50% Rabatt auf den ersten Monat aller bezahlten Stufen (Go 11$, Explore 27,50$, Build 66$), Angebot endet am 14. Oktober 2026
  • • Textmodell in allen Stufen ist "M3.1 Flash Preview" (plus Bild- und Audioerzeugung, Websuche und multimodales Verstehen); Explore und Build enthalten zusätzlich das H3-Videomodell, Go nicht
  • • Feature-Limits (Free/Go/Explore/Build): geplante Aufgaben 5/15/20/50, Website-Deployments 20/50/100/200, Projekte 20/50/100/200; kuratierte Plugins in allen bezahlten Stufen
  • • Jährliche Abrechnung (2 Monate gratis): Go 220$/Jahr (Liste 264$), Explore 550$/Jahr (Liste 648$), Build 1.320$/Jahr (Liste 1.560$)
  • • MiniMax Code ist im Abo enthalten (Web, Desktop, TUI, iOS, Android); ein API-Key bringt den Plan in Claude Code, Codex, Cursor, OpenCode und WorkBuddy
  • • Token Plan Go 22$/Monat, Explore 55$/Monat, Build 132$/Monat. MiniMax-M3 mit dauerhaft 50% Rabatt
  • • Nutzungsbasierte Abrechnung (einheitlicher Quota-Pool über alle Modelle): einfache Aufgaben verbrauchen weniger, Nutzungsanzeige in der Konsole ist maßgeblich (Doku-FAQ, Sep 2026)
  • • Credits: 5$=5k, 25$=25k, 100$=100k (1k Credits = 1$). 365 Tage gültig
  • • Jährliche Abrechnung: Go 220$/Jahr, Explore 550$/Jahr, Build 1.320$/Jahr (2 Monate gratis)
  • • Quota-Fenster: 5h gleitend + wöchentlich; parallele Agents 3-4 (Go), 4-5 (Explore), 6-7 (Build)
  • • Geschätzt ~1,7 / ~5,1 / ~12,5 Mrd. Tokens pro Monat M3-Nutzung (Go/Explore/Build)
  • • Hailuo-2.3-Videogenerierung: 3 Clips/Tag (Explore), 5 Clips/Tag (Build)
  • • M2.7-Referenzabrufe pro 5h-Fenster: Go ~4.500 / Explore ~15.000 / Build ~29.077 (teilt sich Quota mit M3)
  • • M2.7-highspeed-Referenzabrufe pro 5h-Fenster: Go ~2.250 / Explore ~7.500 / Build ~14.538
  • • Tägliche M3-Coding-Aufrufe pro Monat (~50K Tokens pro Aufruf): Go ~34.000 / Explore ~102.000 / Build ~250.000
  • • Dynamische Ratenbegrenzung in Stoßzeiten (typischerweise Werktags 15:00-17:30); RPM/TPM-Drosselung setzt sich meist nach ~1 Minute zurück
  • • Token Plan ist für interaktive Einzelentwickler-Nutzung gedacht — für Produktion wird Pay-as-you-go empfohlen
  • • Musikserie eingestellt — seit 20. August 2026 keine Musikmodelle im Token Plan (Open-Source MiniMaxAI/MiniMax-Music3 auf Hugging Face)
  • • MiniMax H3 (Reasoner) wird in der Token-Plan-Preis-Doku als NICHT unterstützt gelistet — sie nennt die komplette MiniMax-Reihe (M3 / M2.7 / Bild / Sprache) als abgedeckt, nur wenige Spezialmodelle (MiniMax H3, Voice-Design, schnelles Voice-Cloning) sind ausdrücklich ausgenommen; Credits unbegrenzt für Standardmodelle. Die Subscribe-Seite (Okt 2026) widerspricht dem und listet H3 als in Explore und Build enthaltenes Videomodell
  • • Freund-Empfehlung: Eingeladene erhalten 10% Rabatt auf alle Token-Plan-Käufe/-Upgrades, Werber erhalten Open-Platform-Credits im Wert von 10% der Zahlung (90 Tage gültig, nur zur Verrechnung von API-Gebühren)
  • • Migrations-Ausgleichs-Credits: Übergangszuschuss für Nutzer des nutzungsbasierten Quota-Modells mit eigener Gültigkeitsdauer; die Gültigkeit wurde von 1 Monat auf 1 Jahr korrigiert
  • • Abo-Quota wird zuerst verbraucht, gekaufte Credits decken den zulässigen Überhang; ein Subscription Key ist getrennt vom Pay-as-you-go-API-Key und funktioniert auch ohne Plan (nur Credits)
  • • MiniMax-M2.5 nicht mehr Teil des Token-Plan-Angebots (Doku listet M3 / M2.7 / Bild / Sprache); seit 6. August 2026 eingestellt
  • • Token Plan für Teams: Neue Sitzkäufe seit 5. September 2026 ausgesetzt (Doku dient bestehenden Kunden als Referenz; gemeinsamer Credits-Pool, Sitze 1:1 zugewiesen)
  • • Übersee-Plattform platform.minimax.io (USD, kein +86). Festlandchina: platform.minimaxi.com (erfordert +86)
Mistral

Mistral

Aktualisiert: 2026-10-05

FR
Free
$0/Monat
Begrenzte Nachrichten, Websuchen, Coding-Sessions
ProBeliebt
$14.99/Monat
Mehr Nutzung, ganztägiges Coding in CLI/IDE/Web
Team
$24.99/Monat
24,99$/User/Monat, optionale User-Blöcke 50$/Monat, bis zu 30GB Speicher
Education
$5.99/Monat
5,99$/Monat für verifizierte Studenten, max. 12 Monate, 15$ API-Credits/Monat
Enterprise
Siehe Anbieter
Custom Modelle/Agents, Audit-Logs, SAML SSO

LLM Modelle (5)

CodestralMistral-Medium-3.5Mistral-Large-3Mistral-Small-4Mistral-OCR-4.1

Features

  • Vibe CLI für Coding
  • IDE-Extensions
  • Le Chat Integration
  • Extended Thinking
  • Deep Research
  • Code Interpreter
  • Canvas Mode
  • Web-Suche
  • Skills
  • 100+ Connectors
  • MCP-Unterstützung

Hinweise

  • • Free, Pro 14,99$/Monat, Team 24,99$/User/Monat
  • • Free-Tier: begrenzte Nachrichten, Websuchen, Coding-Sessions, 10$ API-Credits/Monat
  • • Pro-Plan (14,99$/Monat) enthält Mistral Vibe CLI für ganztägiges Coding und 30$ API-Credits/Monat
  • • Education: 5,99$/Monat für verifizierte Studenten (max. 12 Monate, keine frühere Vibe- oder Le-Chat-Nutzung, zzgl. Steuern), 15$ API-Credits/Monat
  • • Team: 24,99$/User/Monat plus optionale User-Blöcke zu 50$/Monat; Enterprise ist individuell kalkuliert (Kontaktaufnahme)
  • • PAYG-Credits verlängern die Nutzung über das Planlimit hinaus zum API-Tarif (z.B. Mistral Large 0,5$/M Input, 1,5$/M Output)
  • • Batch-Verarbeitung senkt den Preis um 50%, gecachte Input-Tokens senken die Input-Kosten um bis zu 90%
  • • Modell-Training ist in allen Plänen Opt-out
  • • Task-Scheduling: Prompts, Agents oder Workflows laufen automatisch zu festgelegten Zeiten (bis 5 im Free-Tier, unbegrenzt in Paid-Plänen)
  • • Hooks führen benutzerdefinierte Shell-Befehle vor und nach jedem Agent-Turn aus
  • • Teleport übergibt eine Vibe-Session vom lokalen Rechner an einen Remote-Coding-Agenten in isolierter Sandbox und zurück
  • • Remote-Agent-Observability: Run-Historie, Tool-Calls, Code-Änderungen, Logs und Audit-Trails
  • • Custom-MCP-Connectors (Beta) verbinden Vibe mit jedem entfernten MCP-Server
  • • Voice-Modus: Audio aufnehmen oder hochladen, Transkriptionen erhalten, Fragen stellen oder Zusammenfassungen erzeugen
  • • Connectors: 100+ im Free-Tier, bis zu 1.000 in Paid-Plänen
  • • Das Marketing nennt die Vibe CLI und die IDE-Plugins weiterhin "powered by Devstral", Devstral 2 wurde jedoch am 22. Mai 2026 deprecated und am 31. Juli 2026 abgeschaltet
  • • Codestral: dediziertes Code-Modell (v25.08)
  • • Devstral-2: am 22. Mai 2026 deprecated, am 31. Juli 2026 abgeschaltet — ersetzt durch Mistral Medium 3.5
  • • Mistral-Medium-3.5: Frontier multimodal, 128B dense, 77,6% SWE-bench, 256K Kontext
  • • Mistral-Small-4: hybrides Modell, vereint Instruct, Reasoning und Coding
  • • Z.ai GLM 5.3/5.2 auf der Mistral-Plattform verfügbar (Open-Source-Modelle von Drittanbietern)
  • • Flash-Antworten: 150/Tag bei Pro, 200/Tag bei Team
  • • Mistral Medium 3.5 (v26.04) und OCR 4.1 sind die Featured-Modelle; Mistral Large 3 (v25.12), Mistral Small 4 (v26.03) und Codestral (v25.08) ebenfalls aktuell
  • • Z.ai GLM 5.3 und 5.2 sind als Modelle auf der Mistral-Plattform gelistet (Open-Source-Modelle von Drittanbietern); GLM 5.2 am 29. Sep 2026 deprecated, Abschaltung 31. Okt 2026 (Alternative GLM 5.3)
  • • Dokumenten-Upload: im Free-Tier limitiert, bis zu 15GB bei Team, bis zu 30GB/User bei Enterprise
  • • Studentenrabatt: verifizierte Studenten zahlen 5,99$/Monat statt 14,99$ für Pro (max. 12 Monate, keine frühere Vibe-/Le-Chat-Nutzung)
Moorethreads

Moorethreads

Aktualisiert: 2026-10-04

CN
Free Trial
$0/Monat
40 Anfragen/5h
30 Tage kostenlos, ~40 Prompts/5h, wie Claude Pro, nicht wiederholbar. Tägliches Limit: 100 Entwickler — vollständig ausgebucht, Kapazität wird ausgebaut
Lite
$6/Monat
120 Anfragen/5h
~6$/Monat (¥120/Quartal), ~120 Prompts/5h, 3x Claude Pro Nutzung
ProBeliebt
$28/Monat
600 Anfragen/5h
~28$/Monat (¥600/Quartal), ~600 Prompts/5h (3x Claude Max 5x), höhere Generierungsgeschwindigkeit
Max
$56/Monat
2.4K Anfragen/5h
~56$/Monat (¥1200/Quartal), ~2400 Prompts/5h (3x Claude Max 20x), Priorität zu Spitzenzeiten

LLM Modelle (1)

GLM-4.7

Features

  • MTT S5000 GPU-Beschleunigung
  • Hardware-Software-Co-Optimierung
  • Hochgeschwindigkeits-Inferenz-Engine
  • Multi-Ökosystem-Kompatibilität
  • Quartalsabrechnung

Hinweise

  • • Free Trial, Lite, Pro, Max (CNY-Preise). Läuft auf MTT S5000 GPU. Kompatibel mit Claude Code, Cursor, OpenCode
  • • Prompts pro 5h (Doku): Free ~40, Lite ~120 (3x Claude Pro), Pro ~600 (3x Claude Max 5x), Max ~2400 (3x Claude Max 20x)
  • • Jeder Prompt verbraucht schätzungsweise 15-20 Modellaufrufe
  • • Modell: GLM-4.7
  • • Am 4.10.2026 geprüft (Landingpage headless gerendert + Doku plan_overview): Quartalspreise 120/600/1200¥, Prompts-pro-5h-Kontingente 40/120/600/2400 und die reine GLM-4.7-Modellliste unverändert. Endpunkt: coding-plan-endpoint.kuaecloud.net (Anthropic) / /v1 (OpenAI), Modell-ID GLM-4.7, Thinking-Modus unterstützt
Novita AI

Novita AI

Aktualisiert: 2026-10-04

US
Lite
$19.9/Monat
50M Tokens/Monat, 45 RPM. Für einzelne Entwickler
ProBeliebt
$49.9/Monat
150M Tokens/Monat, 150 RPM. 3× Lite-Nutzung, für 2-5 Person-Teams
Max
$199.9/Monat
750M Tokens/Monat, 450 RPM. 15× Lite-Nutzung, für 10+ Person-Teams

LLM Modelle (8)

DeepSeek-V4-ProGLM-5Kimi-K2.5Qwen3.5-397B-A17BMiniMax-M2.7GLM-4.7MiniMax-M2.5MiniMax-M2.1

Features

  • Abo-basierte Token-Pläne
  • Multi-Modell-Zugang (GLM, Kimi, DeepSeek, Qwen, MiniMax)
  • Einheitlicher API-Zugang — Modelle frei wechseln
  • Enterprise-Grade-Zuverlässigkeit
  • Keine Modellbeschränkungen über Plattformen

Hinweise

  • • Abo-Pläne: Lite 19,9$/Monat (50M Tokens, 45 RPM), Pro 49,9$/Monat (150M Tokens, 150 RPM), Max 199,9$/Monat (750M Tokens, 450 RPM)
  • • Modelle: GLM-5, GLM-4.7, Kimi K2.5, DeepSeek V4 Pro, MiniMax M2.1/M2.5/M2.7, Qwen3.5-397B-A17B
  • • DeepSeek-V3.2 am 1.10.2026 entfernt: nicht mehr in den offiziellen Pack-deductRules unter api-server.novita.ai/v1/product/resource-pack-specs/list — die verbleibenden 8 Modelle wurden dort geprüft
  • • Am 4.10.2026 geprüft über api-server.novita.ai/v1/product/resource-pack-specs/list: Preise, Kontingente und dieselben 8 Modell-deductRules unverändert (novita.ai/llms.txt enthält keinen Coding-Plan-Abschnitt). Alle drei Stufen sind weiterhin auf 50M Tokens/Minute begrenzt, ein Paket pro Konto, kein Aktionspreis (discountPrice = price)
  • • Flexible monatliche Abrechnung, jederzeit kündbar
  • • Keine Überraschungen — feste monatliche Preise
N

NVIDIA NIM

Aktualisiert: 2026-10-04

US
Free TierBeliebt
$0/Monat
Ratenlimitbasierter Free-Trial (~40 RPM Basis, unveröffentlicht pro Modell), nur Dev/Testing

LLM Modelle (15)

Kimi-K3Kimi-K2.6GLM-5.3GLM-5.3-FlashDeepSeek-V4.1-FlashNemotron-4-340B-InstructNemotron-3-Super-120B-A12BNemotron-3-Ultra-550B-A55BNemotron-3.5-Lightning-30B-A3BNemotron-3-Nano-Omni-30B-A3B-ReasoningNemotron-3.5-Content-SafetyMuse-Glimmer-30BLaguna-XS-2.1GPT-OSS-20BGemma-4-31B

Features

  • 102 Modelle via Katalog (81 kostenlose Endpoints)
  • OpenAI-kompatibler Endpunkt
  • Self-hosting via NIM Container
  • GPU-Sandbox-Instanzen (B300/B200/H200)
  • NemoClaw Agent-Sicherheit
  • Blueprints für RAG/Agenten

Hinweise

  • • Keine Abo-Pläne: Free-Trial-Zugang + unveröffentlichte Rate-Limits pro Modell
  • • Free Tier: ratenlimitbasiert (Credit-System Sep 2025 eingestellt), ~40 RPM Basis, nur Dev/Testing, 102 Modelle im Katalog
  • • Katalog am 4.10.2026 erneut geprüft: build.nvidia.com/models paginiert weiterhin über 5 Seiten (~100 Katalogeinträge), integrate.api.nvidia.com/v1/models liefert weiterhin 81 kostenlose Endpoints. Alle 15 gelisteten Modelle bestätigt, keines entfernt
  • • Neu seit 1.10.: nvidia/nemotron-4-340b-instruct (Nemotron 4, Nachfolgergeneration der Nemotron-3-Linie) — aufgenommen
  • • Neueste kostenlose Endpoints: deepseek-v4.1-flash (~2 Wo.), glm-5-3 und glm-5-3-flash (~2,5 Wo.), kimi-k3 / nemotron-3.5-lightning-30b-a3b / muse-glimmer-30b (~1 Mon.)
  • • Kimi-K2.6 ist seit 1.10.2026 wieder im kostenlosen Katalog (moonshotai/kimi-k2.6 mit aktivem Endpoint, Modellseite 200) — wieder aufgenommen
  • • Weiterhin nicht im kostenlosen Katalog: GLM-5.2, MiniMax-M3, DeepSeek-V4-Pro/Flash, Llama-3.3-70B, GPT-OSS-120B, Step-3.7-Flash — und kein Qwen-Textmodell (nur qwen-image)
  • • EOL seit 29.09.2026: Mistral-Nemotron (integrate.api liefert HTTP 410 Gone, nicht mehr in /v1/models) — entfernt. Steht weiterhin auf der Katalogseite, hat aber keinen kostenlosen Endpoint
  • • Am 27.09.2026 entfernt und am 2.10.2026 erneut geprüft: Llama-3.2-90B-Vision-Instruct und Llama-3.2-11B-Vision-Instruct (Modellseiten leiten auf /experience-unavailable weiter), Nemotron-3-Nano-Omni-30B-A3B (kein Endpoint; Ersatz ist Nemotron-3-Nano-Omni-30B-A3B-Reasoning)
  • • Bezahlt: Pro-Modell-Tokenpreise über Deploy (~0,04-3,60$/M Tokens) oder AI Enterprise (~4.500$/GPU/Jahr)
Ollama Cloud

Ollama Cloud

Aktualisiert: 2026-10-05

US
Free
$0/Monat
Starter-Usage-Credits, Zugriff auf Starter-Modelle, 1 gleichzeitige Anfrage. Lokale Nutzung unbegrenzt
ProBeliebt
$20/Monat
$17/Monat jährlich
60$ Usage-Credits/Monat, größere Pro-Modelle, mehrere Modelle parallel, 3 gleichzeitige Anfragen. 200$/Jahr bei jährlicher Abrechnung (16,67$/Monat)
Max
$100/Monat
300$ Usage-Credits/Monat, Early Access zu neuesten Modellen, 10 gleichzeitige Anfragen
TeamBeta
$500/Monat
500$/Monat, unbegrenzte User, 1.000$ Usage-Credits/Monat geteilt, zentrale Abrechnung und Admin
Enterprise
Siehe Anbieter
Custom terms, model access controls, cost budgets, private Slack channel with dedicated support, custom security questionnaires

LLM Modelle (17)

GLM-5.3GLM-5.3-FlashDeepSeek-V4-ProDeepSeek-V4.1-FlashGLM-5.2Gemma-4Kimi-K3Kimi-K2.6Kimi-K2.7-CodeMiniMax-M2.7MiniMax-M3Mistral-Large-3Nemotron-3-SuperNemotron-3-UltraNemotron-3-NanoGPT-OSS-120BGPT-OSS-20B

Features

  • $-basierte Nutzungs-Credits (monatlich inklusiv)
  • Zusätzliche Usage-Credits (alle Pläne)
  • Keine Datenspeicherung
  • Monatliche inklusive Nutzung setzt am Abo-Datum zurück
  • 17 Cloud-Modelle
  • 40.000+ lokale Modelle

Hinweise

  • • Free (1 gleichzeitige Anfrage), Pro 20$/Monat (60$ Usage-Credits, 3 gleichzeitig), Max 100$/Monat (300$ Usage-Credits, 10 gleichzeitig). Team 500$/Monat (Early Access, unbegrenzte User, 1.000$ Usage-Credits geteilt)
  • • Die inklusive Nutzung in Dollar setzt monatlich am Abo-Startdatum zurück; keine Übertragung
  • • Nutzung in Tokens zu Modell-Raten (pro Million Input, Cached Input, Output)
  • • Pro beinhaltet größere Pro-Modelle und den parallelen Betrieb mehrerer Modelle; Max ergänzt Early Access zu neuesten Modellen und 10 gleichzeitige Anfragen
  • • Free beinhaltet Starter-Usage-Credits für eine kleinere Menge an Starter-Modellen
  • • Lokale Nutzung immer unbegrenzt
  • • Native Gewichte, keine Quantisierung
  • • Gehostet über NVIDIA Cloud Provider
  • • Cloud-Modellliste: 17 Modelle (deepseek-v4-pro + deepseek-v4.1-flash, gemma4, glm-5.2/5.3/5.3-flash, gpt-oss 20b+120b, kimi-k2.6/2.7-code/k3, minimax-m2.7/m3, mistral-large-3, nemotron-3 nano/super/ultra)
  • • Wechsel von einem bestehenden Pro- oder Max-Tarif setzt die Nutzung zurück: der neue Tarif steht sofort zur Verfügung, Session- und Wochenlimits des alten Tarifs entfallen; das Reset-Datum bleibt am ursprünglichen Startdatum
  • • Modelle und Compute werden primär in den USA gehostet, zusätzliche Kapazität kann über Europa und Singapur laufen
  • • Gleichzeitige Anfragen: Free 1, Pro 3, Max und Team 10. Anfragen über dem Limit werden bis zu einer festen Warteschlangengröße eingereiht und bei voller Warteschlange abgelehnt
  • • Paid-Pläne verschicken bei 90% der inkludierten Monatsnutzung eine E-Mail-Erinnerung (abschaltbar)
  • • Ein Ollama-Konto pro Person; zwischen Personal- und Team-Konto wechselt man mit demselben Login
  • • Off-Peak-Preise gelten außerhalb von 12:00-18:00 UTC werktags und ganztags am Wochenende
OpenAI Codex

OpenAI Codex

Aktualisiert: 2026-10-05

US
Free
$0/Monat
Codex erkunden, begrenzte Nutzung
Go
$8/Monat
Leichte Coding-Tasks
PlusBeliebt
$20/Monat
GPT-6 Astra: 5-45, GPT-6.1 Sol: 15-160, GPT-6 Sol: 15-150, GPT-6 Luna: 350-3,000 msgs/5h
Pro 5xBeliebt
$100/Monat
5× Plus Limits, Priority Processing
Pro 20x
$200/Monat
20× Plus Limits, Priority Processing
Pro 100x
$500/Monat
Höchster Pro-Tarif 500$/Monat, inklusive GPT-6 Astra Ultrafast
Business
$25/Monat
$20/Monat jährlich
$25/user/month ($20/user annual, 2+ users). Same as Plus with governance, IP indemnity, centralized billing

LLM Modelle (12)

GPT-5.6-SolGPT-5.6-TerraGPT-5.6-LunaGPT-5.5GPT-5.4GPT-5.4-miniGPT-6-AstraGPT-6.1-SolGPT-6-SolGPT-6-LunaGPT-Rosalind-ResearchGPT-Image-2

Features

  • CLI, IDE, Web, iOS
  • GitHub Code Review
  • Slack-Integration
  • Linear-Integration
  • Cloud-Tasks
  • Local-Tasks
  • GPT-5.6-Modellfamilie
  • Credits für zusätzliche Nutzung

Hinweise

  • • Free, Go 8$, Plus 20$, Pro 5x 100$, Pro 20x 200$, Pro 100x 500$. Business 20$/Seat (jährlich), 25$/Monat, Enterprise custom
  • • GPT-5.6 Sol: beste Qualität; Terra: Allround-Standard; Luna: schnell & günstig
  • • GPT-6.1 Sol: nahe Astra-Leistung zu geringeren Kosten als Astra, Rollout für Plus, Pro, Business, Enterprise und Edu (bei Enterprise/Edu standardmäßig aus bis Admin es aktiviert); nicht in Free/Go; Ultrafast-Support folgt später
  • • Nutzungslimits geteilt zwischen lokal & cloud (5h-Fenster)
  • • Pro-Pläne haben derzeit kein 5-Stunden-Limit; die 5h-Schätzungen gelten für Plus und Standard Business
  • • 5h-Schätztabelle der Doku am 5. Okt 2026 erneut geprüft: gelistet ist nur noch die GPT-6-Familie (GPT-6.1 Sol, GPT-6 Sol, GPT-6 Luna, GPT-6 Astra); die Schätzzeilen für GPT-5.6/5.5/5.4 bleiben entfernt
  • • ChatGPT Work und Codex teilen sich Preise, Credits und Nutzungslimits
  • • Nutzungslimits werden außerdem mit ChatGPT for Excel auf Plus und Pro geteilt
  • • Wird das Limit in einem laufenden Turn erreicht, beendet Codex diesen Turn (Fair-Use-Limits gelten)
  • • Pro 5x: 5× Plus Limits, Priority Processing
  • • Pro 20x: 20× Plus Limits, Priority Processing
  • • Pro 100x: höchster Pro-Tarif für 500$/Monat, inklusive GPT-6 Astra Ultrafast
  • • Credits verfügbar für erweiterte Nutzung
  • • Credits pro 1M Tokens: GPT-6 Sol 50/5/250 (Input/Cached/Output)
  • • GPT-6.1 Sol: 50/2,5/250 Credits pro 1M Tokens (Input/Cached/Output)
  • • GPT-6-Luna: 2,5/0,25/12,5 Credits pro 1M Tokens (Input/Cached/Output)
  • • Credits pro 1M Tokens: GPT-5.6 Sol 100/10/500, Terra 50/5/300, Luna 5/0,5/30 (Input/Cached/Output)
  • • GPT-5.4 und GPT-5.4 mini stehen nicht mehr in der Credit-Rate-Card und nicht in der 5h-Schätztabelle (am 3. Okt 2026 erneut geprüft)
  • • GPT-5.5 wird am 14. Oktober 2026 eingestellt
  • • GPT-6-Astra: Premium-Frontier-Modell (5-45 msgs/5h bei Plus)
  • • GPT-6-Astra: 250/25/1250 Credits pro 1M Tokens (Input/Cached/Output)
  • • GPT-Rosalind-Research: 125/12,5/625 Credits pro 1M Tokens (Input/Cached/Output)
  • • Geschwindigkeits-Multiplikatoren gegenüber Standard: Fast Mode 2,5x auf inkludierte Abo-Nutzung und 2x auf gekaufte Credits; GPT-6 Astra Ultrafast 8x inklusive / 6x gekaufte Credits (Pro 100x und berechtigte Enterprise/Edu)
  • • Sprach-Eingabe in der Desktop-App nutzt das Codex-Nutzungsbudget für 0,05$/Minute; 1,25 Credits/Minute bei Business, Edu und Enterprise mit Credit-Abrechnung sowie für Plus/Pro mit zusätzlichem Credit-Verbrauch; teilt die Plan-Nutzungslimits und ist nicht per API-Key verfügbar
  • • Sites ist während der Public Beta in berechtigten ChatGPT-Plänen enthalten (Verfügbarkeit abhängig von Plan, Region und Workspace-Einstellungen)
  • • GPT-5.6 Sol Aktionspreis mindestens bis 21. November 2026
  • • Business (100$ flexible Abrechnung) nutzt Pro-5x-Nutzungsschätzwerte
  • • Daybreak Blue/Red verfügbar (Trusted Access for Cyber); Daybreak Blue zum GPT-5.6-Sol-Tarif, Daybreak Red 312,5/31,25/1875 Credits pro 1M
  • • GPT-Image-2: Bildgenerierung über Codex; Credits 200/50/750 (Bild) bzw. 125/31,25/250 (Text) pro Mio. Tokens; Bildgenerierung verbraucht Limits 3-5x schneller; nicht im Free-Plan
  • • API-Key-Nutzung: Pay-per-Token (CI-Automation; keine Cloud-Features)
OpenCode Go

OpenCode Go

Aktualisiert: 2026-10-05

US
GoBeliebtBeta
$5 Erster Monat
$10/Monat
$10/Monat jährlich
$60/Monat
Intro: 5$ erster Monat, dann 10$/Monat (120$/Jahr). Inkludierte Nutzung 15$-60$ pro Modell/Monat
Go PlusBeta
$40/Monat
$240/Monat
40$/Monat. Höhere Nutzungslimits für dieselben Modelle (60$-240$ inkludierte Nutzung pro Monat)

LLM Modelle (30)

Grok-4.7Grok-4.6GLM-5.3GLM-5.3-FlashGLM-5.2GPT-5.6-LunaKimi-K3Kimi-K2.7-CodeKimi-K2.6LongCat-2.0LongCat-2.5-Preview-FreeMiMo-V2.5MiMo-V2.5-ProMiMo-V2.6-FlashMiMo-V2.6-ProMiniMax-M3MiniMax-M2.7Muse-Spark-1.3-ContributorMuse-Spark-1.2-ContributorQwen3.8-MaxQwen3.8-FlashQwen3.7-PlusDeepSeek-V4-ProDeepSeek-V4-FlashDeepSeek-V4-Flash-Vision-ExpHy3Hy4-previewDeepSeek-V4.1-FlashGPT-6-LunaSpace-Bunny-Free

Coding Tools

Features

  • Offene Modelle
  • Globale Edge-Bereitstellung (US/EU/SG)
  • Geringe Latenz
  • Pay-as-you-go Backup

Hinweise

  • • Zwei Tarife: Go 10$/Monat (erster Monat 5$, bzw. 120$/Jahr) und Go Plus 40$/Monat. 30 kurierte offene Coding-Modelle. Hosting in US/EU/Singapur
  • • Monatliche Nutzungslimits in Dollar, variieren je Modell (Go 15$-60$, Go Plus 60$-240$); 5h-Fenster = 20% des Monatslimits, Woche = 50%, Monat = 100%
  • • Beide Tarife liefern dieselbe Modellliste zu identischen Token-Preisen — Go Plus hebt nur das monatliche Dollar-Limit an
  • • Nur ein Mitglied pro Workspace kann Go oder Go Plus abonnieren
  • • Modelle gehostet in US, EU und Singapur für stabilen globalen Zugang
  • • Kuratierte Auswahl offener Modelle für OpenCode-Kompatibilität getestet
  • • Nach Limits kann Zen-Guthaben genutzt werden (wenn aktiviert); Gratis-Modelle (LongCat 2.5 Preview Free, Space Bunny Free) bleiben unbegrenzt
  • • API-Endpoints: opencode.ai/zen/go/v1/responses, /v1/chat/completions und /v1/messages; aktuelle Modellliste unter opencode.ai/zen/go/v1/models
  • • Model-ID-Format in der Config: opencode-go/<model-id>
  • • Muse Spark 1.3/1.2 Contributor: Prompts und Completions werden zum Training zukünftiger Meta-Modelle genutzt, kein ZDR, nur ausgewählte Regionen
  • • Grok 4.7/4.6 und GPT 6 Luna/GPT 5.6 Luna: 30 Tage Datenaufbewahrung; alle anderen Modelle 0 Tage
  • • Qwen3.7 Plus, Grok 4.7/4.6 und GPT 6 Luna/GPT 5.6 Luna haben höhere Token-Raten im Long-Context (>256K/>200K/>272K)
  • • GLM-5.1, Qwen3.7-Max und Qwen3.6-Plus aus der kuratierten Modell-Liste entfernt (Sep 2026)
  • • Qwen3.8-Flash und Hy4-preview zur kuratierten Modell-Liste hinzugefügt (Aug 2026)
  • • Muse-Spark-1.3-Contributor zur kuratierten Modell-Liste hinzugefügt (Sep 2026)
  • • DeepSeek-V4.1-Flash zur kuratierten Modell-Liste hinzugefügt (Sep 2026)
  • • LongCat-2.5-Preview-Free ersetzt MiniMax-M2.5 in der kuratierten Modell-Liste (Sep 2026)
  • • Grok-4.7, MiMo-V2.6-Flash, MiMo-V2.6-Pro zur kuratierten Modell-Liste hinzugefügt (Sep 2026)
  • • Modell-Liste am 5. Okt 2026 erneut geprüft: 30 kuratierte Modelle, unverändert. Die Doku veröffentlicht außerdem geschätzte Anfragen pro 5 Stunden / Woche / Monat je Modell (z. B. Grok 4.7: 169/423/845 auf Go, 676/1.692/3.380 auf Go Plus)
  • • GPT-6-Luna und Space-Bunny-Free zur kuratierten Modell-Liste hinzugefügt (Sep 2026); Space Bunny Free nur zeitlich begrenzt
  • • Validierte Clients: Hermes, Claude Code, Codex, ZCode, Pi, jcode (>=v0.81.6), Kilo Code CLI
  • • Bekannte problematische Clients (unvollständige Session-Unterstützung): DeepSeek Harness, GitHub Copilot Chat, Kimi Code, MiMo Code
  • • DeepSeek-Modelle kosten in den Peak-Zeiten 01:00-04:00 & 06:00-10:00 UTC Mo-Fr das Doppelte; alle anderen Zeiten inkl. Wochenende sind Off-Peak
  • • DeepSeek-ZDR-Vereinbarung wird monatlich erneuert, aktuell gültig bis 31. Okt 2026
OpenRouter

OpenRouter

Aktualisiert: 2026-10-04

US
Free
$0/Monat
21 kostenlose Einträge (19 Text-/Coding-Modelle, 2 Lyria-3-Musikpreviews), 50 Anfragen/Tag, 20 Anfragen/Min. 1000 Anfragen/Tag ab mindestens $10 gekauften Credits
Pay-as-you-go
Siehe Anbieter
5,5% Plattformgebühr, 500+ Modelle, 80+ Anbieter
Business
Siehe Anbieter
Pay-as-you-go mit 8% Plattformgebühr, 1000 Workspaces, erhöhte Ratenlimits
Enterprise
Siehe Anbieter
Individuelle Preise. SSO, BYOK bis $200.000/Monat ohne Gebühren, SLAs, Volumenverpflichtungen

LLM Modelle (19)

Nemotron-3-Ultra-550B-A55BLaguna-S-2.1InklingSpace Bunny AlphaNemotron-3-Super-120B-A12BGemma-4-26B-A4BGemma-4-31BQwen3.8-27BInkling-SmallApodex-1.1-MiniLing-3.1-FlashLing-3.0-Flash-SanteLFM2.5-2.6BLaguna-XS-2.1Nemotron-3.5-LightningNemotron-3-Nano-Omni-30B-A3BDots-3-Note-PreviewNorth-Mini-CodeNemotron-3.5-Content-Safety

Features

  • Auto-Routing
  • Prompt-Caching
  • OpenAI-kompatible API
  • 500+ Modelle von 80+ Anbietern
  • Kein Setup nötig

Hinweise

  • • Free: 50 Anfragen/Tag, 21 kostenlose Einträge von 11 Herausgebern laut /api/v1/models?max_price=0 (scripts/openrouter-free-models.json) — 19 Text-/Coding-Modelle sind unten gelistet, die 2 Google-Lyria-3-Previews sind Musikgenerierung. Ratenlimit 20 Anfragen/Min. 1000 Anfragen/Tag ab mindestens $10 gekauften Credits
  • • Am 4.10.2026 geprüft: 21 kostenlose Einträge (19 Text/Coding + 2 Lyria 3) von 11 Herausgebern. Alle 18 zuvor gelisteten Modelle sind weiterhin kostenlos, keines entfernt. Neu seit 2.10.: inclusionai/ling-3.1-flash (Hybrid-Reasoning-MoE, 25B aktiv von 560B, 262K Kontext) — aufgenommen, inclusionAI damit mit 2 kostenlosen Einträgen
  • • inclusionai/ling-3.0-flash-fin und ling-3.0-flash sind kostenpflichtig (0,000000042 / 0,000000021$ pro Prompt) — kostenlos sind Ling-3.1-Flash und Ling-3.0-Flash-Sante
  • • stealth/space-bunny-alpha hat seine :free-Variante verloren und wird nur noch als einfacher 0$-Eintrag mit expiration_date 2026-10-05 ausgeliefert — das Modell dürfte in Kürze aus dem kostenlosen Katalog verschwinden; dots-studio/dots-3-note-preview:free läuft am 31.12.2026 ab
  • • Free-Tier-Sonderfälle: fehlgeschlagene Anfragen zählen zum Tageslimit und ein negativer Credit-Stand sperrt die kostenlosen Modelle. Zusätzliche Konten oder API-Keys erhöhen die Limits nicht
  • • Free: keine Plattformgebühr, kein Prompt-Caching, kein Auto-Routing oder Vendor-Auswahl, kein BYOK, 5 Workspaces (Zero-Data-Retention-Routing gibt es in jedem Plan)
  • • Pay-as-you-go: 5,5% Plattformgebühr (min. 0,80$ via Stripe, 5% via Coinbase/USDC), 500+ Modelle, 80+ Anbieter, kein Aufschlag auf Providerpreise, Ratenlimits des Providers werden durchgereicht
  • • BYOK: gebührenfrei bis $25.000/Monat List-Preis-Inferenz bei Pay-as-you-go und Business (darüber 5%), $200.000/Monat bei Enterprise (darüber 5%)
  • • Business: 8% Plattformgebühr, 1000 Workspaces, Admin-Kontrollen, EU/US-In-Region-Routing, E-Mail-Support — vertragliche SLAs gibt es nur bei Enterprise
  • • Enterprise: BYOK bis $200.000/Monat List-Preis-Inferenz ohne Gebühren (danach 5%), individuelle Preise, SSO, SLAs, Volumenverpflichtungen
  • • Auto-Routing wählt das beste Modell für jede Anfrage
  • • Prompt-Caching reduziert Kosten bei wiederholten Präfixen
  • • Aggregiert Modelle von mehreren Anbietern über eine einzige API
QwenCloud Token Plan

QwenCloud Token Plan

Aktualisiert: 2026-10-05

SG
Lite
$6 Erster Monat
$8/Monat
11.5K Anfragen/Monat
Zeitlich begrenztes 6$/Monat-Angebot (regulär 8$). 11.500 Credits/Monat (keine 5h-Quota). 1-2 parallele Agents
Essential
$10 Erster Monat
$16/Monat
25.5K Anfragen/Monat
Zeitlich begrenztes 10$/Monat-Angebot (regulär 16$). 2,25x Lite-Credits: 25.500 Credits/Monat. 2-3 parallele Agents
StandardBeliebt
$18 Erster Monat
$25/Monat
45.0K Anfragen/Monat
Zeitlich begrenztes 18$/Monat-Angebot (regulär 25$). 4x Lite-Credits: 45.000 Credits/Monat. 3-4 parallele Agents
Pro
$68 Erster Monat
$80/Monat
180.0K Anfragen/Monat
Zeitlich begrenztes 68$/Monat-Angebot (regulär 80$). 16x Lite-Credits: 180.000 Credits/Monat. 6-8 parallele Agents
Team Standard
$20 Erster Monat
$30/Monat
Zeitlich begrenztes 20$/Sitz/Monat-Angebot (regulär 30$). 25.000 Credits/Monat pro Sitz
Team Pro
$75 Erster Monat
$100/Monat
Zeitlich begrenztes 75$/Sitz/Monat-Angebot (regulär 100$). 100.000 Credits/Monat pro Sitz
Team Max
$200/Monat
250.000 Credits/Monat pro Sitz

LLM Modelle (11)

Qwen3.8-MaxQwen3.7-MaxQwen3.7-PlusQwen3.8-FlashQwen3.6-FlashGLM-5.3GLM-5.2DeepSeek-V4-ProDeepSeek-V4-Pro-0813DeepSeek-V4-Flash-0731DeepSeek-V4.1-Flash

Features

  • Mehrere Modelle in einem Plan
  • Text-, Vision-, Sprach- und Bildgenerierung
  • OpenAI- und Anthropic-kompatible Endpunkte
  • Harness-Tools: Websuche, Code-Interpreter
  • Credit-Packs für zusätzliche Kapazität
  • Credit-Abrechnung über alle Modelle

Hinweise

  • • Credit-basiertes Abo: Monats-Quota pro 30-Tage-Abozyklus (Wochenquota am 22. Sep 2026 entfernt)
  • • Individual: Lite 8$/Monat, Essential 16$/Monat, Standard 25$/Monat, Pro 80$/Monat. Zeitlich begrenzte Promos: 6$/10$/18$/68$ pro Monat
  • • Team-Sitze: Standard 30$, Pro 100$, Max 200$ pro Sitz/Monat (Promo 20$/75$)
  • • Credit-Packs: 15$/Monat für 20.000 Credits (Individual), 700$/Monat für 625.000 Credits (Team); bis zu 5 Packs gleichzeitig, ohne Ablauf
  • • Globale/Singapur-Plattform, kein +86. Internationales Angebot, getrennt vom Alibaba-Cloud-Coding-Plan
  • • Quartals- und Jahresabrechnung auf der Preisseite verfügbar
  • • Nacht-Rabatt (22:00-08:00 UTC+8): 60% auf Credits für qwen3.8-max und qwen3.8-flash; 50% für deepseek-v4-pro-0813, deepseek-v4-flash-0731 und deepseek-v4.1-flash. qwen3.8-max-preview zurückgezogen — Anfragen werden automatisch auf qwen3.8-max geroutet
  • • Das 5-Stunden-Kontingent wurde durch eine feste 7-Tage-Fenster-Quota ersetzt (Aug 2026), dann durch eine Monats-Quota (30-Tage-Abozyklus, 22. Sep 2026); parallele Anfragen innerhalb des Fensters möglich
  • • Einmalige "Reset Usage Limit"-Leistung für Abonnenten (begrenzte Gesamtnutzung) — setzt das Monats-Quota-Fenster sofort zurück
  • • Empfehlungsprogramm: 4$ Guthaben pro Erstzahlung eines Freundes (Preisseite, Sep 2026)
  • • Ein separater QwenCloud-Coding-Plan wird nicht mehr gelistet — docs.qwencloud.com/coding-plan/overview leitet auf den Token Plan weiter; die Preisseite zeigt keinen separaten Coding Plan
  • • Die Team Edition garantiert, dass deine Daten nicht zum Modelltraining verwendet werden; Personal- und Team-Edition können parallel gehalten und unabhängig abgerechnet werden
  • • Die Quota wird bei Abschluss gesammelt gutgeschrieben, nicht täglich verteilt; eine Verlängerung verlängert nur den Abo-Zeitraum und fügt der laufenden Periode keine zusätzliche Quota hinzu
  • • Die Personal Edition unterstützt derzeit keine Kündigung; vorgesehen für die Nutzung auf einem Gerät pro Nutzer — das Teilen des API-Keys gilt als Verstoss und kann zur Sperrung führen
  • • Upgrades setzen den laufenden Zyklus nicht zurück: Es wird der anteilige Preisunterschied berechnet, Credits werden anteilig nach Quota-Differenz gutgeschrieben, die Monatsquota der neuen Stufe gilt erst ab dem nächsten Abo-Monat
Replit

Replit

Aktualisiert: 2026-10-05

US
Starter
$0/Monat
Kostenlose tägliche Agent-Checkpoints, Agent-Chat & Free Mode mit Tages-Cap, Design Canvas + Visual Editor, 1 veröffentlichte App (30 Tage), keine kostenpflichtige Modellauswahl
CoreBeliebt
$20/Monat
$18/Monat jährlich
20$/Monat (18$/Monat jährlich = 216$/Jahr). Full Build, Plan Mode, Design-zu-Artefakt, alle Artefakttypen, Connectors, Kanban-Planung, 1 aktive Hintergrundaufgabe, bis zu 5 Mitarbeiter, unbegrenzt viele Apps
Pro
$100/Monat
$90/Monat jährlich
100$/Monat (90$/Monat jährlich). 10 parallele Agents, 100$ in Richtung der stärksten Modelle, Premium-Support, bis zu 15 Mitarbeiter, DB-Rollback 28 Tage, abgestufte Monats-Credits mit 2-Monats-Rollover
Enterprise
Siehe Anbieter
Custom. Individuelle Sitz-Limits, SSO/SAML, erweiterte Privatsphäre, Single-Tenant-Umgebungen, statische ausgehende IPs

LLM Modelle (7)

Claude Opus 5Claude Opus 4.8Claude Sonnet 5GPT-5.6GPT-5.5Gemini-3.1-ProGemini-3.7-Flash

Features

  • Replit Agent (autonome Long-Builds)
  • Agent-Modi: Free, Power, Max + Auto-Modell-Routing
  • Parallele Agents
  • Effort-basierte Preisberechnung (ein Checkpoint pro Request)
  • Datenbank-Rollbacks
  • 20$ inkludierte Modell-Nutzung (Core)
  • 100$ inkludierte Modell-Nutzung (Pro)
  • Bis zu 5 Mitarbeiter (Core)
  • Bis zu 15 Mitarbeiter (Pro)
  • Unbegrenzt veröffentlichte Apps (Core/Pro)
  • Sofort-Deployment (Web-Apps, APIs, statische Seiten)
  • Integrierte PostgreSQL
  • Custom Domains
  • Design Canvas + Visual Editor
  • Kanban-Aufgabenplanung
  • Drittanbieter-Modelle (Claude, ChatGPT, Gemini) zu Provider-Raten
  • Abgestufte Monats-Credits mit 2-Monats-Rollover (Pro)

Hinweise

  • • Preisseite + docs.replit.com/billing/ai-billing am 05.10.2026 erneut verifiziert: keine Preisänderungen, Karteninhalte identisch zum 03.10. — Core 20$/Monat (18$/Monat jährlich = 216$/Jahr, 20$ in Richtung der stärksten Modelle, AI-Integrationen, bis zu 30h Chat und 60 Projekte im Free Mode, Plan Mode, unbegrenzte Workspaces), Pro 100$/Monat (90$/Monat jährlich = 1.080$/Jahr, 10 parallele Agents, 100$ in Richtung der stärksten Modelle, mehr Free-Mode-Nutzung, Premium-Support, bis zu 15 Mitarbeiter, 50 Viewer einladbar, DB-Rollback bis 28 Tage, 100$ Credits, „Save $10“-Upsell-Badge), Enterprise individuell (Enterprise-grade Sicherheit und Kontrolle, individuelle Sitz-Limits, SSO/SAML, erweiterte Privatsphäre-Kontrollen, Single-Tenant-Umgebungen, statische ausgehende IPs und mehr). Starter wird auf der Preisseite nicht gelistet, ist aber in der AI-Billing-Tabelle der Doku dokumentiert. Der Jahresrabatt lautet „bis zu 10%“. Auch die AI-Billing-Tabelle der Doku ist unverändert: Agent-Chat ✅/✅/✅, Free Mode mit Tages-Cap, intelligentes Modell-Routing ❌/✅/✅, Full Build ❌/✅/✅, Design Canvas ✅/✅/✅, Design-zu-Artefakt ❌/✅/✅, Visual Editor ✅/✅/✅, alle Artefakttypen ❌/✅/✅, Plan Mode ❌/✅/✅, Connectors ❌/✅/✅, Aufgabenplanung (Kanban) ❌/✅/✅, aktive Hintergrundaufgaben 0/1/10, Kollaborations-Sitze 0/5/15, veröffentlichte Apps 1 (30 Tage)/unbegrenzt/unbegrenzt, Replit-Badge-Entfernung ❌/✅/✅.
  • • Änderung 27.09. → 28.09.: Replit hat seine Agent-Modi umbenannt. Laut docs.replit.com/features/agent/agent-modes lautet der Selektor jetzt Free Mode / Power Mode / Max Mode — „Economy Mode is no longer available. Power Mode replaces it at the same price." Power Mode ist die kostensoptimierte Voreinstellung, Max Mode nutzt leistungsfähigere Modelle; Free Mode nutzt immer intelligentes Modell-Routing. Core- und Pro-Builder können in Power oder Max Auto (intelligentes Modell-Routing) wählen — Auto ist eine kostenpflichtige Alternative zu Free Mode und nutzt Abo-Credits; Enterprise-Workspaces nutzen einen einzigen Auto-Modus anstelle von Free Mode, und Workspace-Admin legen die erlaubten Modell-Provider fest. Modi wechseln mit ⌘+Shift+I (Strg+Shift+I unter Windows). Routines laufen nicht im Free Mode — sie erfordern Power/Max plus ein Budget pro Lauf.
  • • AI-Billing-Tabelle der Doku (05.10.2026 erneut verifiziert) je Plan Starter/Core/Pro: Agent-Chat ✅/✅/✅, Free Mode mit Tages-Cap, intelligentes Modell-Routing ❌/✅/✅, Full Build ❌/✅/✅, Design Canvas ✅/✅/✅, Design-zu-Artefakt ❌/✅/✅, Visual Editor ✅/✅/✅, alle Artefakttypen ❌/✅/✅, Plan Mode ❌/✅/✅, Connectors ❌/✅/✅, Aufgabenplanung (Kanban) ❌/✅/✅, aktive Hintergrundaufgaben 0/1/10, Kollaborations-Sitze 0/5/15, veröffentlichte Apps 1 (30 Tage)/unbegrenzt/unbegrenzt, Replit-Badge-Entfernung ❌/✅/✅. Alle Abonnenten erhalten einmalig kostenlose Agent-Checkpoints. Render-Hinweis vom 05.10.: Die Starter-/Core-/Pro-Bullets sind sonst identisch, aber der Pro-Bullet „Tiered monthly credits with rollover for ." rendert in diesem Fetch erneut mit leerer Dauer, die Zweimonats-Rollover-Periode bleibt also zuletzt über die Replit-Pro-Planseite verifiziert.
  • • Nutzungsbasierte Agent-Abrechnung: effort-basierte Credits, genau ein Checkpoint pro Request (komplexe Builds werden gebündelt), Bestätigung vor jeder kostenpflichtigen Aktion, Plan Mode kann abrechenbares Reasoning auslösen auch ohne Code-Änderungen, bezahlte Drittanbieter-API-Modelle (Claude, ChatGPT, Nano Banana/Gemini) zum Provider-Tarif und von den Replit-Credits abgezogen, Credit-Packs mit Mengenrabatten, Nutzungswarnungen und harte Budget-Caps unter Account → Billing. Pro-Credits laufen zwei Monate über (ProCreditRolloverPeriod). Nutzungsdaten können bis zu 30 Minuten nachlaufen; eine interaktive Kosten-Demo für Beispiel-Apps liegt unter agent-pricing.replit.app.
Sakana AI

Sakana AI

Aktualisiert: 2026-10-05

JP
Standard
$20/Monat
20$/Monat. Baseline-Nutzung, leichte tägliche Nutzung. Inkl. Fugu + Fugu Ultra + Fugu Max.
ProBeliebt
$100/Monat
100$/Monat. 10× Standard-Nutzung, fokussierte Arbeitssitzungen. Inkl. Fugu + Fugu Ultra + Fugu Max.
Max
$200/Monat
200$/Monat. 20× Standard-Nutzung, schwere Langzeit-Workloads. Inkl. Fugu + Fugu Ultra + Fugu Max.

LLM Modelle (4)

FuguFugu UltraFugu MaxFugu Cyber

Coding Tools

Features

  • Fugu + Fugu Ultra + Fugu Max in jedem Tarif
  • Multi-Modell-Orchestrierung
  • Einzelner API-Endpunkt
  • Dynamisches Modell-Routing
  • Tokenplan (Pay-as-you-go)

Hinweise

  • • Abo-Pläne am 05.10.2026 auf der zweisprachigen Fugu-Landingpage erneut verifiziert — unverändert: Standard Plan 20$/Monat (Baseline-Nutzung, leichte tägliche Nutzung, gelegentliche API-Aufrufe und kleine Experimente), Pro Plan 100$/Monat (10× Standard, fokussierte Arbeitssitzungen, regelmäßiges Coding/Review/Recherche über die Woche), Max Plan 200$/Monat (20× Standard, schwere Langzeit-Workloads, Power-User, die Fugu über tiefere Aufgaben hinweg aktiv halten). Jeder Tarif enthält Fugu, Fugu Ultra und Fugu Max. Vier Modelle über eine OpenAI-kompatible API: Fugu (ausgewogen, in Tools wie Codex für Coding und Code-Review einsetzbar), Fugu Ultra (v2.0, qualitätsoptimiert), Fugu Max (v1.0, kostenleistungsoptimiert, integriert die NVIDIA-Nemotron-Familie), Fugu Cyber (v1.0, auf Cybersicherheit spezialisiert, preislich über Vertrieb). Registrierung unter console.sakana.ai (die Seite empfiehlt den Token Plan für ernsthafte Workloads und positioniert die Abos als casual, alltägliche Nutzung). Noch nicht in EU/EEA verfügbar, während an der GDPR-Konformität gearbeitet wird.
  • • Neue Benchmark-Abschnitte auf der Seite (30.09.2026). Quantitative Results: Fugu Ultra (v2.0) erzielt auf fünf von acht Benchmarks den besten oder mit besten Score (GDP.pdf, Chartography, DeepSWE, Toolathon und das interne SWEFish) und liegt auf sieben von acht in den Top 2. Fugu Max (v1.0) erreicht den besten Gesamtscore auf sechs Benchmarks, darunter Terminal Bench 2.1, GPQAD, AA-LCR, GDP.pdf, AutomationBench und SWEFish, und erweitert die Kosten-Performance-Pareto-Frontier auf sieben von zehn Benchmarks. Fugu Cyber (v1.0) erreicht 86,9% auf CyberGym und 72,1% auf CTI-REALM, vergleichbar mit GPT-5.5-Cyber und Mythos-Preview. Fugu-Ultra-Trainings-Cutoff 20260828 — Fable 5, Fable 5.1 und GPT-6-Astra sind NICHT im Fugu-Ultra-Pool. Die Output-Preisberechnung von Fugu Max liegt 40–60% unter Sonnet 5, GPT-5.6 Terra und Kimi K3.
  • • Neuer Abschnitt Qualitative Results (30.09.2026): sechs Fallstudien gegen drei anonymisierte Frontier-Baselines (Gemini 3.1 Pro high, Opus 4.8 max, GPT 5.5 xhigh, dort als Model A/B/C bezeichnet mit absichtlich nicht fester Zuordnung) — AutoResearch BPB (Fugu-Ultra bester Mittelwert 0,9774±0,0019, bester Einzelrun 0,9748, vor Model C 0,9781 / B 0,9793 / A 0,9822), Kana-Brief-Lesereihenfolge (NED 0,80 gegenüber 0,24 für Model A, Model C lieferte gar keinen Prädiktor), Rubik's-Cube-Solver (löste alle 300 Würfel, 19,72 Züge im Mittel gegenüber 19,76, 7 Siege/293 Unentschieden/0 Niederlagen, während Modelle B und C abstürzten und 0/300 lieferten), CAD-Mekapflügel, vier Partien Blindschach (gewinnt gegen drei Frontier-Modelle und eine 2100-Elo-Stockfish) und ein 50-Wochen-Aktienhandels-Fenster (Portfolio 11.943,22$ ± 633,86$, +19,43% mittlere Rendite gegenüber unter +15% für die Baselines). Fugu Ultra basiert außerdem auf zwei ICLR-2026-Papern (TRINITY und der Conductor, arXiv 2606.21228). Neu seit 03.10.2026: der Abschnitt Users' Voices hat jetzt fünf Testimonials — ein Software-Engineer, der sein gesamtes Code-Review auf Fugu Ultra umgestellt hat, nachdem es 20+ Probleme fand, wo andere Tools rund drei meldeten, ein Industrieforscher, der eine Patent-Landschaft über ~20 Papers von 3–4 Tagen auf wenige Stunden verkürzte, ein Plattform-Executive mit ungewöhnlich stabiler Persona über lange Sessions und ein Akademiker für die Paper-Reproduktion. Seit dem 03.10. kam ein fünftes Testimonial hinzu, das eine Security-Assessment-Kampagne beschreibt, die aus einer einzigen, eng abgegrenzten Anweisung durchgängig geführt wurde — Recon, XSS/SQLi-Prüfungen, Auth-Review, sauberer Report mit Belegen und Retest-Schritten — innerhalb des Scopes und ohne destruktive Aktionen. Die Seite nennt außerdem explizit den Rollout-Takt: Wenn ein neues Frontier-Modell öffentlich erscheint, rechnet Sakana mit rund zwei Wochen Training und Evaluierung der aktualisierten Fugu-Modelle vor dem Rollout.
  • • Pay-as-you-go-Tokenplan unverändert: Fugu wird zum Standard-Rate des zugrunde liegenden Modells abgerechnet (nie gestapelt — bei mehreren aktiven Agenten nur der Top-Tier-Model-Rate); Fugu Ultra 5$/30$ pro 1M Tokens Input/Output, 0,50$ cached input, über 272K Kontext 10$/45$/1,00$; Fugu Max 2$/6$ pro 1M, 0,25$ cached input, Flatrate unabhängig vom Kontext, web_search/web_fetch 0,007$/Aufruf. Verbrauchstokens werden mit höherer Priorität als Abo-Tokens verarbeitet. Bei Fugu lassen sich einzelne Modelle in der Konsole für Daten-/Privacy-/Compliance-Gründe ausschließen; Enterprise-Kunden können individuelle Modell- oder Provider-Konfigurationen anfragen; die Nutzung von Trainingsdaten kann jederzeit abgewählt werden.
Sourcegraph Amp

Sourcegraph Amp

Aktualisiert: 2026-10-05

US
Hobby
$0/Monat
0$/Monat. Pay-as-you-go-Orbs, eigene Runner kostenlos, BYOK, ChatGPT-Abo nutzbar, keine Amp-Token-Gebühren
MegawattBeliebt
$20/Monat
20$/Monat (Individual, CTA „Get Megawatt", Megawatt/Gigawatt-Umschalter). 45.000 Minuten Orb-Nutzung, kostenloses Sticker-Pack, Tokens von überall, BYOK, unbegrenzte Repos, eigene Domains
Gigawatt
$200/Monat
200$/Monat. Mitglieds-Tier über Megawatt. Nicht mehr als Preis-Karte auf der Preisseite
Teams
$0/Monat
Kostenlos. Mitglieder auf beliebigen Tiers, SAML/OIDC SSO, gepoolte Credits, gemeinsame Abrechnung
UnconstrainedEingestellt
Siehe Anbieter
Nutzungsbasierte Abrechnung (alte Preisseite). Ersetzt durch Hobby und Enterprise-Conditions
Enterprise
Siehe Anbieter
Custom. Nur gepoolte Credits, SCIM, Spend-Limits, Audit-Logs, IP-Allowlisting, regionale Endpunkte, Forward-Deployed-Engineering-Hilfe

LLM Modelle (9)

Claude Opus 5.5GPT-6-AstraGPT-5.6-SolGPT-5.6-TerraGLM-5.2GLM-5.3-FlashGemini-3.7-FlashGPT-Image-2Fable 5.1

Features

  • Frontier-Coding-Agent (Terminal + Editor)
  • Multi-Model: Opus 5.5 (Standard-Agent für Medium) + GPT-6 Astra + Fable 5.1 + GPT-5.6 Sol/Terra + GLM-5.3-Flash + GLM-5.2 + Gemini 3.7 Flash
  • Parallele Subagents
  • Pay-as-you-go zu API-Kosten (ohne Aufschlag)
  • Codebase-Intelligenz via Sourcegraph-Graph
  • Teilbare Threads/Workflows für Teams
  • Null LLM-Speicherung auf Enterprise

Hinweise

  • • Preisseite am 05.10.2026 erneut verifiziert: weiterhin vier Karten, keine Preisänderungen (unverändert ggü. 03.10.) — Hobby 0$ (NEW-Badge; Pay-as-you-go für Orbs, eigene Runner kostenlos, Tokens von überall, ChatGPT-Abo & andere Abos nutzbar, BYOK, keine Amp-Token-Gebühren oder -Limits, öffentliche/private Repos), Individual 20$/Monat mit CTA „Get Megawatt" und Megawatt/Gigawatt-Umschalter (45.000 Minuten Orb-Nutzung, Tokens von überall, ChatGPT-Abo & andere Abos nutzbar, BYOK, keine Amp-Token-Gebühren oder -Limits (NEU), unbegrenzte öffentliche/private Repos, eigene Domains für Portale, kostenloses Sticker-Pack für Orb-Zeit), Teams „No extra charge" (NEW-Badge; Mitglieder auf verschiedenen Tiers Hobby/Megawatt/Gigawatt, Team-Thread-Sharing/Multiplayer/Rechte, geteilte Portale/Plugins/Skills, Benutzerverwaltung/Kontrollen/Analytics, gemeinsame Abrechnung und gepoolte Credits, SAML/OIDC SSO, eigene Domains für Portale, Tokens von überall, ChatGPT-Abo, BYOK, keine Amp-Token-Gebühren oder -Limits, geteiltes BYOK & Modell-Routing), Enterprise (custom; nur gepoolte Credits, keine bezahlten Sitze, SCIM-Directory-Sync, Spend-Limits & Reporting, Audit-Logs und Netzwerk-/MCP-Zugriffskontrollen, IP-Allowlisting & regionale Endpunkte, höhere Ressourcen-Quotas & Rate-Limits, Priority-Support/Rechnstellung/individuelle Bedingungen, Forward-Deployed-Engineering-Hilfe verfügbar). Eine Änderung ggü. 03.10.: der kostenlose Orb-Zeit-Sticker-Pack-Bullet fehlt auf der Individual-Karte wieder (am 03.10. vorhanden, am 02.10. und jetzt wieder ausgefallen), das bestätigt die Lesart vom 03.10., dass es sich um ein Render-Artefakt und nicht um eine echte Streichung handelt. Gigawatt ist weiterhin nicht als Preis-Karte gelistet — nur als Mitglieds-Tier. Unconstrained-Nutzungsabrechnung bleibt entfernt.
  • • Modelle laut /modes am 05.10.2026 erneut verifiziert — Modellzuordnungen vollständig unverändert (Medium = Opus 5.5 · high, damit bleibt Opus 5.5 das Standard-Agent-Modell von Amp): Low=GLM-5.3-Flash · high, Oracle GPT-6 Astra · x-high; Medium=Opus 5.5 · high, Oracle GPT-6 Astra · x-high; High=GPT-6 Astra · med, Oracle Fable 5.1 · x-high; Ultra=Fable 5.1 · high, Oracle GPT-6 Astra · x-high; Puck=GPT-5.6 Sol; Subagent Search=GPT-5.6 Terra, Oracle=GPT-6 Astra+Fable 5.1, Librarian=GPT-5.6 Sol, Read Thread=GLM-5.2; Systemmodelle GPT Transcribe (Dictation), GPT Live 1 (Realtime Voice), Gemini 3.7 Flash (View Media), GPT Image 2 (Painter), Titling und Compaction = Same as Thread. Das am 03.10. aus dem Text-Render gefallene Zeitfenster des Nutzungsdiagramms ist wieder da und deckt jetzt SEP 26 bis OCT 5 ab, das Fenster-Rollover lässt sich damit wieder verfolgen.
StepFun

StepFun

Aktualisiert: 2026-10-05

CN
Flash Mini
$6.99/Monat
$6/Monat jährlich
400M Credits/Monat. Vierteljährlich 18,99$. Booster: Small 6,99$/400M, Large 9,99$/1.600M
Flash Plus
$9.99/Monat
$8/Monat jährlich
1.600M Credits/Monat. Vierteljährlich 26,99$. Priority API-Raten & Support
Flash ProBeliebt
$29/Monat
$24/Monat jährlich
8.000M Credits/Monat. Vierteljährlich 79$. Priority API-Raten & Support
Flash Max
$99/Monat
$82/Monat jährlich
40.000M Credits/Monat. Vierteljährlich 269$. Priority API-Raten & Support

LLM Modelle (7)

Step-3.7-FlashStep-3.5-Flash-2603Step-3.5-FlashStep-Router-V1Step-5-PreviewStepAudio-2.5-TTSStepAudio-2.5-ASR

Features

  • Credit-basiertes Monatskontingent ($1 ≈ 7M Credits)
  • Step 3.7 Flash multimodales Reasoning
  • Natives Bild-/Video-Verstehen
  • Booster-Pakete bei aufgebrauchtem Kontingent
  • Keine Ratenlimits (RPM/TPM)
  • Mehrere Abrechnungszyklen (monatlich/vierteljährlich/jährlich)
  • Studio-Erstellungs-Credits (40% des Plan-Kontingents)

Hinweise

  • • Credit-basierte Abrechnung: $1 ≈ 7M Credits. Flash Mini 400M/6,99$/Monat, Plus 1.600M/9,99$/Monat, Pro 8.000M/29$/Monat, Max 40.000M/99$/Monat
  • • Vierteljährliche und jährliche Abrechnung verfügbar. Credits monatlich ausgegeben, innerhalb des Monats verwendbar, laufen nicht über
  • • Booster-Pakete: Small 6,99$/400M (30 Tage gültig), Large 9,99$/1.600M (30 Tage gültig). Nur für aktive Step-Plan-Abonnenten
  • • Step-5-Preview: Frontier-Reasoning-Modell, multimodaler Input (Text/Bild/Video) mit 1M-Token-Kontext
  • • Base URL: Claude Code/Anthropic SDK https://api.stepfun.ai/step_plan; OpenAI Chat Completions https://api.stepfun.ai/step_plan/v1
Synthetic

Synthetic

Aktualisiert: 2026-10-04

US
Subscription PackBeliebt
$30/Monat
500 Anfragen/5h
500 Requests/5h, 24$/Woche Credits, 3× höhere Rate-Limits als Claude 20$/Monat, 1 gleichzeitige Anfrage pro Modell
Usage-based
Siehe Anbieter
Pay-per-use, no subscription required

LLM Modelle (8)

Kimi-K3Nemotron-3-Super-120B-A12BGPT-OSS-120BQwen3.8-27BDeepSeek-V4.1-FlashGLM-5.3GLM-5.3-FlashGLM-4.7-Flash

Features

  • Pauschaler Monatspreis — keine Pro-Token-Abrechnung
  • Always-on-Modelle inklusive
  • 3× höhere Rate-Limits als Claude 20$/Monat
  • Funktioniert mit jedem Agent-Framework
  • Fokus auf Open-Weight-Modelle
  • OpenAI-kompatible API
  • Embeddings kostenlos enthalten (nomic-embed)

Hinweise

  • • Pauschaler Monatspreis mit 3× höheren Rate-Limits als Claude 20$/Monat
  • • Jedes Pack: 500 Requests/5h, 24$/Woche API-Credits, 1 gleichzeitige Anfrage pro Modell — weitere Packs erhöhen die Limits
  • • Credits/Requests regenerieren inkrementell (kein fester Reset-Lockout): 5h-Kontingent +5% alle 15 Min, Wochen-Credits +2% alle 202 Min
  • • Requests werden anhand des Eingabepreises skaliert: Kimi-K3 Basis (1,0), GLM-5.3-Flash ~10× günstiger (~0,1 Request pro Aufruf)
  • • Standard-Modelle: Kimi-K3, Nemotron-3-Super-120B-A12B-NVFP4, gpt-oss-120b, Qwen3.8-27B, DeepSeek-V4.1-Flash (Beta), GLM-5.3 (Beta), GLM-5.3-Flash, GLM-4.7-Flash; GLM-5.2 ist kein Standard-Modell mehr; Embeddings (nomic-embed-text-v1.5) kostenlos, zählen nicht gegen die Limits
  • • Kontextfenster: DeepSeek-V4.1-Flash 512k (Beta), Kimi-K3 512k, GLM-5.3 512k (Beta), GLM-5.3-Flash 512k, Nemotron 256k, Qwen3.8-27B 256k, GLM-4.7-Flash 192k, gpt-oss-120b 128k
  • • Enterprise-Alternative "Agents for enterprise": nutzungsbasierter Zugriff auf alle Modelle zu Pay-per-Token-Raten
  • • 5-Stunden-Request-Limit regeneriert +5% alle 15 Min, Wochen-Credits +2% alle 202 Min — nie ein vollständiger Lockout, Burst-Nutzung ohne Strafe
  • • Am 04.10.2026 erneut geprüft gegen synthetic.new/pricing und synthetic.new/rate-limits — Pack-Preise (1$/Tag bzw. 30$/Monat), 500 Requests/5h, 24$/Woche Credits und 1 gleichzeitige Anfrage pro Modell unverändert; der Standard-Modellsatz umfasst weiterhin genau 8 Modelle (DeepSeek-V4.1-Flash Beta, Kimi-K3, Nemotron-3-Super-120B, gpt-oss-120b, Qwen3.8-27B, GLM-4.7-Flash, GLM-5.3 Beta, GLM-5.3-Flash)
Tabnine

Tabnine

Aktualisiert: 2026-10-04

US
FreeEingestellt
Siehe Anbieter
Free-Plan 2024 eingestellt
ProEingestellt
$12/Monat
Eingestellt
Code AssistantBeliebt
$39/Monat
39$/Benutzer/Monat (jährlich, letzter öffentlich gelisteter Preis). KI-Vervollständigungen + Chat, alle großen LLMs, flexibles Deployment
Agentic Platform
$59/Monat
59$/Benutzer/Monat (jährlich, letzter öffentlich gelisteter Preis). Code Assistant + agentische Workflows, CLI, Context Engine, MCP, SSO, SOC 2, Air-Gapped
Enterprise
Siehe Anbieter
Quote-basierter Preis via Tricentis Sales. Private Installation (SaaS/VPC/On-Prem/Air-Gapped), dedizierter Support, eigene LLM-Endpunkte

LLM Modelle (20)

Tabnine Custom ModelGPT-5.5GPT-5.4GPT-5.3-CodexClaude Opus 4.8Claude Opus 4.7Claude Opus 4.6Claude Opus 4.5Claude Sonnet 4.6Claude Sonnet 4.5Claude Haiku 4.5Gemini-3.5-ProGemini-3.1-ProGemini-3-ProDevstral-2-123BDevstral-Small-2-24BMiniMax-M2.7GLM-4.7Qwen3-Coder-480B-A35BQwen3-30B

Features

  • KI-Code-Vervollständigungen
  • KI-Chat (Anthropic, OpenAI, Google, Meta, Mistral)
  • Agentische Workflows
  • CLI
  • Context Engine
  • MCP-Tools
  • SSO
  • SOC 2
  • Air-Gapped-Deployment

Hinweise

  • • Code Assistant 39$/Benutzer/Monat (jährlich), Agentic Platform 59$/Benutzer/Monat (jährlich) — zuletzt öffentlich gelistete Preise. SaaS/VPC/On-Prem/Air-Gapped
  • • Von Tricentis übernommen (Agentic Quality Engineering). tabnine.com/pricing leitet jetzt auf die Tricentis-Seite "Contact us" — keine öffentlichen Preise, Quote-basiert (Sales-Kontakt); docs.tabnine.com listet nur noch Enterprise (SaaS) und Enterprise (private installation) als Abo-Pläne, erneut verifiziert am 01.10.2026
  • • Enterprise: Quote-basiert, private Installation (SaaS/VPC/On-Prem/Air-Gapped) mit dediziertem Support
  • • Tabnine positioniert sich als vollständig privater, organisationsbewusster AI-Coding-Agent, der komplett in der eigenen Umgebung läuft — Agent via CLI oder IDE, plus Tabnine Chat
  • • Agentic Platform = Code Assistant + agentische Workflows, Tabnine CLI, Context Engine, MCP-Tools; Headless-Agents-Add-on verfügbar
  • • Unbegrenzte Nutzung mit eigenem LLM (On-Prem oder Cloud-Endpunkt). Bei Tabnine-bereitgestelltem LLM-Zugang Abrechnung zu tatsächlichen Anbieterpreisen + 5% Bearbeitungsgebühr
  • • Die Modellliste stammt aus docs.tabnine.com/main/welcome/readme/ai-models.md — Claude 4.8/4.7/4.6/4.5/4 Opus+Sonnet+Haiku, GPT-5.5/5.4/5.3 Codex/5.2 Codex/5.2/5/4o, Gemini 3.5 Pro/3.1 Pro/3.0 Pro, Devstral 2 123B + Small 24B, MiniMax-M2.7, GLM-4.7, Qwen3-Coder-480B-A35B und Qwen3-30B (nur Chat); die Seite weist darauf hin, dass sich die Liste häufig ändert
  • • Am 04.10.2026 erneut geprüft gegen docs.tabnine.com/main und docs.tabnine.com/main/welcome/readme/ai-models.md (vollständige Modellliste) sowie www.tabnine.com/pricing (leitet weiterhin auf die Tricentis-Seite "Contact us", keine öffentlichen Preise) — keine Preisänderung, alle 20 Chat-Modelle unverändert
Tencent Cloud LLM

Tencent Cloud LLM

Aktualisiert: 2026-10-05

CN
Lite (Common)
$6/Monat
780 Credits/Monat (¥39), ~70 Fragerunden. Credit-Abrechnung seit 31.08.2026
Standard (Common)
$14/Monat
1.980 Credits/Monat (¥99), ~200 Fragerunden. Credit-Abrechnung seit 31.08.2026
Pro (Common)Beliebt
$42/Monat
5.980 Credits/Monat (¥299). Credit-Abrechnung seit 31.08.2026
Max (Common)
$83/Monat
11.980 Credits/Monat (¥599). Credit-Abrechnung seit 31.08.2026
Lite (Hy)
$4/Monat
560 Credits/Monat (¥28), ~70 Fragerunden
Standard (Hy)
$11/Monat
1.560 Credits/Monat (¥78), ~200 Fragerunden
Pro (Hy)
$34/Monat
4.760 Credits/Monat (¥238)
Max (Hy)
$67/Monat
9.360 Credits/Monat (¥468)

LLM Modelle (16)

AutoHy3Hy4-previewGLM-5.3GLM-5.3-FlashGLM-5.2GLM-5.1GLM-5MiniMax-M3MiniMax-M2.7Kimi-K2.7-CodeKimi-K3DeepSeek-V4-ProDeepSeek-V4-FlashDeepSeek-V4.1-FlashMiMo-V2.6-Flash

Features

  • Multi-Provider-Modellzugang
  • Hunyuan-native Modelle
  • Hy Token Plan mit Hy3 / Hy4-Preview
  • Credit-basierte (积分) Abrechnung
  • Hoher Durchsatz
  • Auto-Smart-Routing

Hinweise

  • • Credit-basierte Abrechnung (积分) seit 31. August 2026 17:00 Uhr (Peking-Zeit) — Token-Kontingente in Credits umgestellt, Preise unverändert
  • • Common-Pläne: Lite 780 Credits (¥39), Standard 1.980 (¥99), Pro 5.980 (¥299), Max 11.980 (¥599)
  • • Hy-Pläne (Hy3 / Hy4-Preview): Lite 560 (¥28), Standard 1.560 (¥78), Pro 4.760 (¥238), Max 9.360 (¥468)
  • • Credit-Verbrauch pro Anfrage = (Input-Tokens ohne Cache × Input-Faktor + Output-Tokens × Output-Faktor + Cache-Treffer × Cache-Faktor) / 1.000.000
  • • Hy Token Plan im April 2026 mit Hy3-Preview-Modell für Agent-Workloads gestartet
  • • Hy4-Preview ist jetzt auch in der Common-Token-Plan-Modellliste (Doku aktualisiert 24. Sep. 2026) — Hy3 bleibt reguläres Hy-Modell; Hy3-Preview-Anfragen werden automatisch auf Hy3 geroutet
  • • Doku (24. Sep. 2026): pro Hauptaccount max. 2 Token-Pläne — 1 Common + 1 Hy (je ein Tarif); beide teilen sich einen API Key und eine URL, Credits werden automatisch nach Model ID abgezogen; keine Rückerstattung
  • • Nutzung nur in AI-Coding-Tools (Claude Code, CodeBuddy Code, OpenClaw …) — API-/Skript-/Batch-Aufrufe verstoßen gegen die Bedingungen und können Abo oder API Key sperren; parallele Rat Limits: Max > Pro > Standard > Lite
  • • Neue unterstützte Tools (Doku 130060): QClaw, DeepSeek Harness (lokales Agent-Framework), CC Switch (Multi-Tool-Verwaltung); Hy-Token-Plan-Modelle sind text-only (keine Bild-/Video-Eingaben)
  • • Erforderliche Base-URLs (Doku 130060): https://api.lkeap.cloud.tencent.com/plan/v3 (OpenAI-kompatibel) oder https://api.lkeap.cloud.tencent.com/plan/anthropic (Anthropic-kompatibel); beide Pläne teilen sich einen API Key, Credits werden automatisch nach Model ID abgezogen
  • • Hy4-Preview: 770B Gesamt- / 49B aktivierter Parameter, optimiert für Agent, Coding und Produktivität; hohe Ressourcenlast kann zu Spitzenzeiten Anfrage-Rate-Limits auslösen — andere Modelle bevorzugen
  • • GLM-5 und GLM-5.1 werden am 9. Oktober 2026 eingestellt (下线)
  • • DeepSeek-V4.1-Flash ist wieder im Common Token Plan (Doku 30. Sep. 2026) als 原厂直供 (deepseek-v4-flash-0731 / deepseek-flash) — 552B MoE, nativ multimodal; in der Modellliste vom 24. Sep. 2026 war er nicht enthalten
  • • DeepSeek-Varianten (Doku 30. Sep. 2026): DeepSeek-V4-Flash 正式版 = deepseek-v4-flash-202605 (= DeepSeek-V4-Flash-0731), DeepSeek-V4-Pro 正式版 = deepseek-v4-pro-202606 (= DeepSeek-V4-Pro-0813); bestehende Keys werden still upgedatet
  • • MiMo-V2.6-Flash im Common Token Plan ergänzt (Doku 30. Sep. 2026, Model ID mimo-v2.6-flash)
  • • Modelle: Auto, Hy3, Hy4-Preview, GLM-5/5.1/5.2/5.3/5.3-Flash, MiniMax-M2.7/M3, Kimi-K2.7-Code, Kimi-K3, MiMo-V2.6-Flash, DeepSeek-V4.1-Flash/V4-Pro/V4-Flash
  • • Tencent HY 2.0 Instruct/Think und Hunyuan-Modelle aus Coding Plan entfernt (22. Juni 2026)
  • • MiniMax-M2.5 am 6. August 2026 abgekündigt; DeepSeek-V3.2 seit 16. Juli 2026 offline
  • • Kimi-K2.5 wurde am 31. August 2026 abgekündigt — nicht mehr im Common Token Plan
  • • Kimi-K3 in den Common Token Plan aufgenommen (zuvor nur TokenHub)
  • • Aktion Sep 1–30, 2026: Auto, Kimi-K2.7-Code, MiniMax-M3, hy3-202608 verbrauchen Credits mit 50% (5折); GLM-5.3, Hy4-Preview mit 85折
  • • Aktion Sep 1–30, 2026 (Aktivität 2): Kimi-K3 mit 95折
  • • Registrierung erfordert wahrscheinlich eine chinesische Festland-Rufnummer (+86)
Umans AI

Umans AI

Aktualisiert: 2026-10-04

US
Pay-as-you-goBeliebt
Siehe Anbieter
Vorausbezahltes Wallet, Abrechnung pro Token. Wallet-Stufen: Tier 0 2.000 Anf./5h (4 parallel), Tier 1+50$ 4.000/8, Tier 2+250$ 8.000/12, Tier 3+1.000$ 16.000/16
ProEingestellt
$17/Monat
$14/Monat jährlich
FESTPLAN am 1. Aug. 2026 eingestellt. War 170$/Jahr, bis zu 200 Nachrichten/5h, 5 parallel
MaxEingestellt
$42/Monat
$35/Monat jährlich
FESTPLAN am 1. Aug. 2026 eingestellt. War 420$/Jahr, unbegrenzte Tokens, 4 parallele Sessions
Enterprise
Siehe Anbieter
Org-Wallets mit gemeinsamem Budget und Service-Accounts; Legacy-Sitze für bestehende Teams

LLM Modelle (6)

Kimi-K3DeepSeek-V4.1-FlashGLM-5.3GLM-5.3-FlashDeepSeek-V4-Flash-0731Qwen3.6-35B-A3B

Features

  • OpenAI/Anthropic-kompatibler Endpunkt
  • Drop-in für Claude Code
  • Pay-per-Token-Wallet
  • Wallet-Stufen für Burst-Kontrolle
  • Kein Lock-in (eigene Tools)
  • Verwalteter Endpunkt für Softwarearbeit
  • Cloud-Agents

Hinweise

  • • Pay-per-Token mit vorausbezahltem Wallet; feste Monatspläne am 1. August 2026 eingestellt (Referenz im Pläne-Archiv)
  • • Wallet-Stufen wachsen mit Lebenszeit-Top-ups und sinken nie: Tier 0 (erster Top-up) 2.000 Anf./5h, 4 parallel; Tier 1 (50$) 4.000 Anf./5h, 8; Tier 2 (250$) 8.000, 12; Tier 3 (1.000$) 16.000, 16
  • • Powered by Kimi K3, GLM-5.3, GLM-5.3-Flash, DeepSeek-V4.1-Flash, DeepSeek-V4-Flash-0731 und Qwen3.6-35B-A3B (umans-flash)
  • • Kimi-K2.7-Code und GLM-5.2 wurden am 10. September 2026 eingestellt; Nachfolger sind Kimi K3 und GLM-5.3
  • • GLM-5.3 neu (Aug 2026): GLM-5.2-Nachfolger, 1M Kontext, 1,40$/4,40$ pro 1M Tokens, denkt immer
  • • GLM-5.3-Flash neu (Sep 2026): 320B-A18B MoE, 1M Kontext, natives Bildverständnis, 0,15$/0,50$ pro 1M Tokens
  • • Kimi K3: 1M Kontext, natives Bildverständnis, standardmäßig maximale Denktiefe, 3,00$/15,00$ pro 1M Tokens (reasoning_effort: none wird respektiert)
  • • DeepSeek-V4.1-Flash: 552B MoE, 1M Kontext, natives Bildverständnis, 0,15$/0,60$ pro 1M Tokens, vier Denkmodi (Standard: think high)
  • • umans-flash (Qwen3.6-35B-A3B-FP8): 256K Kontext, 200+ tps Ziel, leichtes Ergänzungsmodell für den Workflow
  • • Am 4.10.2026 geprüft über /offers/code/docs, /pricing und api.code.umans.ai/v1/models/info: kein neuer Festplan (nur Pay-per-Token), dieselben 6 Modelle plus qwen3.6-Alias und 2 Labs-Endpunkte, Input-/Output-Preise unverändert. Cache-Read-Preise: Kimi K3 0,30$, GLM-5.3 0,26$, GLM-5.3-Flash 0,03$, DeepSeek-V4.1-Flash 0,028$, DeepSeek-V4-Flash-0731 0,028$, umans-flash 0,05$ pro 1M Tokens; umans-flash ist 0,15$/1,00$ pro 1M
  • • Keine laufende Aktion: der 2x-Top-up-Bonus lief nur bis 10. September 2026. Maximal 20 Bilder pro Anfrage (darüber 400), Wallet-Keys werden nie pausiert
  • • umans-coder (Standard) routet seit 9. September 2026 zu GLM-5.3-Flash und kann sich bei Modellbewertungen ändern
  • • DeepSeek-V4-Pro-0813 eingestellt, lief am 14. September 2026 aus — Nachfolger ist DeepSeek-V4.1-Flash (umans-deepseek-v4.1-flash); dsv4fx3-Aktion (2x Bonus auf Top-ups) endete am 10. September 2026
  • • Die API liefert außerdem zwei kostenlose Playground-Lab-Endpunkte (umans-deepseek-v4.1-flash-lab, umans-mimo-v2.6-pro-lab; 1M Kontext, Bildverständnis) — nicht als reguläre Modelle gelistet
  • • umans-coder Stack für Zuverlässigkeit optimiert
  • • Setup: curl -fsSL https://api.code.umans.ai/cli/install.sh | bash
  • • Funktioniert mit Claude Code, Cursor, Crush, OpenCode, Pi, Cline, omp, Zed, TRAE, Grok CLI, Roo Code, Copilot
  • • Rollendes 5-Stunden-Anfragefenster, leichte Modelle zählen als Bruchteil
  • • Kontostand ist das eigentliche Ausgabenlimit; Wallet kann bei leerem Guthaben pausieren
UniAI

UniAI

Aktualisiert: 2026-10-01

CN
GLM-5 PlanEingestellt
$4.29/Monat
30 Tage unbegrenzte Tokens, 3000 Aufrufe/5h — EINGESTELLT

LLM Modelle (1)

GLM-5

Features

  • GLM-5 unbegrenzter Token-Zugang (30 Tage)
  • 6x Claude Pro Nutzung
  • Hunderte von Milliarden Tokens pro Monat
  • 0,1x API-Preisäquivalent

Hinweise

  • • 30-Tage unbegrenzter Token-Zugang nur für GLM-5 Modell
  • • EINGESTELLT — ¥30-Aktion ausverkauft; keine Selbstbedienungs-Verlängerung seit April 2026
  • • Am 1.10.2026 geprüft: die Doku-Site (maas.ai-yuanjing.com) blockiert alle direkten Requests mit HTTP 400 (WAF); Inhalt über die indexierte Doku-Seite bestätigt (¥30/30 Tage, nur GLM-5, 3000 Aufrufe/5h, Stand 11.03.2026) — unverändert
  • • Ratenlimit war: 3000 Modellaufrufe pro 5 Stunden
  • • Service startete 5 Minuten nach Kauf
  • • Geteilt über alle Unterkonten des Hauptkontos
  • • Registrierung erfordert wahrscheinlich eine chinesische Festland-Rufnummer (+86)
Venice AI

Venice AI

Aktualisiert: 2026-10-05

US
Free
$0/Monat
10 Text-Prompts/Tag, 15 Bild-Prompts/Tag, Basismodelle
Pro
$18/Monat
$15/Monat jährlich
Unbegrenzte Text-Prompts, 1.000 Bilder/Tag, 100 Credits/Monat, einmalig 500 Willkommens-Credits, TEE/E2EE Privatsphäre, API-Zugang
Pro PlusBeliebt
$68/Monat
$57/Monat jährlich
7.500 Credits/Monat, 2 Monate Credit-Banking, 10% Credit-Bonus ggü. Einzelhandel, einmalig 500 Willkommens-Credits, höhere Bild-Limits
Max
$200/Monat
$167/Monat jährlich
22.500 Credits/Monat, 3 Monate Credit-Banking, 12,5% Credit-Bonus ggü. Einzelhandel, einmalig 500 Willkommens-Credits, höchste Limits

LLM Modelle (81)

Claude Opus 5.5Claude Opus 5Claude Opus 4.8Claude Opus 4.7Claude Opus 4.6Claude Opus 4.5Claude Sonnet 5Claude Sonnet 4.6Claude Sonnet 4.5Claude Fable 5Claude Fable 5.1GPT-5.6-SolGPT-5.6-TerraGPT-5.6-LunaGPT-5.5GPT-5.4GPT-5.4-miniGPT-5.4-nanoGPT-5.3-CodexGPT-6-AstraGPT-6-SolGPT-6.1-SolGPT-6-LunaGLM-5.2GLM-5.1GLM-5GLM-5-TurboGLM-5.3GLM-5.3-FlashGLM-4.7GLM-4.7-FlashGrok-4.7Grok-4.6Grok-4.5Grok-4.3Grok-4.20Kimi-K3Kimi-K2.7-CodeKimi-K2.6Kimi-K2.5DeepSeek-V3.2DeepSeek-V4-ProDeepSeek-V4-FlashDeepSeek-V4-Flash-0731MiniMax-M3-PreviewMiniMax-M2.7MiniMax-M2.5Qwen-3.8-MaxQwen3.7-MaxQwen3.6-PlusQwen3.5-397BMiMo-V2.5GPT-OSS-120BGemini-3.6-FlashGemini-3.7-FlashGemini-3.5-FlashGemini-3-FlashGemini-3.1-ProNemotron-3-UltraVenice-Uncensored-1.2GPT-4oGPT-4o-miniGemini-3.8-FlashDeepSeek-V4.1-FlashKimi-K3-FastGLM-4.6Qwen3.7-PlusAion-3.5Aion-3.5-MiniClaude-Sonnet-5.5GPT-5.2GLM-5V-TurboGrok-Build-0.1InklingMiMo-V2.6-FlashSeed-2.1-TurboGemma-4-UncensoredMistral-Small-3.2Qwen-3.8-FlashGemini-3.5-Flash-LiteNemotron-3-Nano-30B

Features

  • Private AI (keine Datenspeicherung)
  • Unzensierte AI
  • Vier Privatsphäre-Modi (Anonymous, Private, TEE, E2EE)
  • Vision-Unterstützung
  • Web-Suche mit Quellenangaben
  • Dokument-Uploads
  • Bildgenerierung
  • Videogenerierung
  • Musikgenerierung
  • Text-to-Speech
  • Charakter-Erstellung
  • OpenAI-kompatible API
  • Credits-System (100 Credits = $1)
  • Krypto-Zahlungen unterstützt

Hinweise

  • • Kostenlos (10 Text-Prompts/Tag), Pro 18$/Monat (100 Credits), Pro Plus 68$/Monat (7.500 Credits), Max 200$/Monat (22.500 Credits). Preise der Pricing-Seite unverändert; Doku-Preise sind API-Preise pro Token. API-Katalog jetzt mit Claude Opus 5.5, GPT-6-Sol, GPT-6-Luna, Grok 4.7 (Sep. 2026).
  • • Einmalig 500 Willkommens-Credits in allen bezahlten Plänen; Credit-Bonus ggü. Einzelhandel 10% (Pro Plus) / 12,5% (Max); 100 Credits = $1.
  • • API-Pläne: nutzungsabhängig zu veröffentlichten Modellraten oder Pro Plus mit $75 monatlichem API-Umsatz, Max mit $225.
  • • Modellkatalog (26. Sep. 2026) neu: Gemini 3.8 Flash, DeepSeek V4.1 Flash, Kimi K3 Fast, GLM 4.6, Qwen 3.7 Plus, Aion 3.5 / 3.5 Mini.
  • • Doku-Modellkatalog (docs.venice.ai/welcome/pricing, 29. Sep. 2026) neu: Claude Sonnet 5.5, GPT-5.2, GLM 5V Turbo, Grok Build 0.1, Inkling, MiMo-V2.6-Flash, Seed 2.1 Turbo, Gemma 4 Uncensored, Mistral Small 3.2, Qwen 3.8 Flash, Gemini 3.5 Flash-Lite, Nemotron 3 Nano 30B; am 1. Okt. 2026 erneut geprüft: zusätzlich GPT-6.1 Sol (openai-gpt-61-sol, 2,50 $ Eingang / 12,50 $ Ausgang, 1050K Kontext, gleiche Langkontext-Stufe wie GPT-6 Sol) sowie GPT-5.6 Terra Pro/Astra Pro/Luna Pro, DeepSeek V4 Pro 0813 / V4 Flash 0731 Fast, Gemma 3 27B IT, Qwen-Image-2/3-Varianten und die MiniMax-M3-Video-/Musik-/Speech-Familie. Über die kuratierte Liste hinaus führt der Katalog außerdem kleine/Snapshot-Varianten (Aion 3.0, Fast/Coder/0813/0423-Snapshots, Gemma 3 27B, Llama 3.x, Qwen 2.5/3.x-Untervarianten) sowie Bild- (GPT Image 2, Nano Banana 2, Grok Imagine 2.0), Video- (Seedance 2.0/2.5, Kling V3, Wan 3.0) und Audio-/Musikmodelle.
Volcano Engine

Volcano Engine

Aktualisiert: 2026-10-03

CN
Lite
$1.38 Erster Monat
$5.56/Monat
1.2K Anfragen/5h9.0K Anfragen/Woche18.0K Anfragen/Monat
~1.200 Anfragen/5h, ~9.000/Woche, ~18.000/Monat
ProBeliebt
$6.93 Erster Monat
$27.78/Monat
6.0K Anfragen/5h45.0K Anfragen/Woche90.0K Anfragen/Monat
~6.000 Anfragen/5h, ~45.000/Woche, ~90.000/Monat, 5x Lite-Nutzung

LLM Modelle (16)

AutoDoubao-Seed-2.1-TurboDoubao-Seed-2.1-ProDoubao-Seed-2.1-LiteDoubao-Seed-2.0-MiniDoubao-Seed-EvolvingDoubao-Seed-2.0-LiteGLM-5.3GLM-5.3-FlashMiniMax-M3Kimi-K2.7-CodeKimi-K2.8-PreviewKimi-K3DeepSeek-V4-ProDeepSeek-V4-FlashDeepSeek-V4.1-Flash

Features

  • ByteDance-Infrastruktur
  • Multi-Provider-Modellzugang
  • ArkClaw-Multimodal-Agent
  • Auto-Modus-Routing
  • Hohe Parallelität
  • Anfragebasierte Kontingente

Hinweise

  • • Coding Plan Lite ¥40/Monat, Pro ¥200/Monat Listenpreis. Agent Plan Small ¥9,9/Monat, Medium ¥49,9/Monat
  • • 限时特惠-Aktion (zeitlich begrenzt, solange Plätze verfügbar): Lite ¥9,9/Monat, Pro ¥49,9/Monat; kontinuierliche Abrechnung 连续包月/包季/包年
  • • Aktionsseite (28. Sep. 2026): kein ArkClaw-kostenlos-mit-Pro-Banner mehr sichtbar; Agent Plan wird jetzt neben Coding Plan beworben (不止 Coding,订阅 Agent Plan🔥); Schlagzeile 限时 9.9 元起
  • • Modelle: Auto, Doubao-Seed-2.1-Pro/2.1-Lite/2.1-Turbo/2.0-Mini/2.0-Lite, Doubao-Seed-Evolving, GLM-5.3/5.3-Flash, MiniMax-M3, Kimi-K2.7-Code/Kimi-K2.8-Preview/Kimi-K3, DeepSeek-V4.1-Flash/V4-Pro/Flash
  • • Doubao-Seed-2.1-Pro (1024k Kontext, 256k Output), Doubao-Seed-2.1-Lite (1024k Kontext) und Doubao-Seed-2.0-Mini (256k Kontext) zu den unterstützten Modellen hinzugefügt (Doku 1925114, aktualisiert 23. Sep. 2026)
  • • DeepSeek-V4.1-Flash in den Coding Plan aufgenommen — 552B MoE, nativ multimodal (原生具备多模态视觉理解能力), 1M Kontext; Deduktionsfaktor 5折-Aktion 23. Sep. – 30. Okt. 2026
  • • Doubao-Seed-2.1-Turbo und Doubao-Seed-2.0-Lite als baldige Einstellung markiert (即将下线) — noch unterstützt
  • • Kimi-K3 neu (nativer Vision-Support, 1M Kontext, hoher Deduktionsfaktor — nur für Pro-Plan empfohlen)
  • • Kimi-K2.8-Preview-Aktion bis 14. Okt. 2026 verlängert (Doku 1925114, am 1. Okt. 2026 erneut geprüft): Die Nutzung im Coding Plan entspricht einem Agent-Plan-Deduktionsfaktor von 6折 (40% Rabatt)
  • • Doubao-Seed-2.0-Pro/2.0-Code, MiniMax-M2.7, Kimi-K2.6 aus dem Coding Plan entfernt (Doku aktualisiert 27. Aug. 2026)
  • • GLM-5.2 eingestellt — aus der Modellliste entfernt (Doku Sept. 2026, war als 即将下线 markiert)
  • • Doubao-Seed-Evolving und GLM-5.3 neu hinzugefügt (je 1M Kontext)
  • • GLM-5.3-Flash multimodal (hinzugefügt 28. Aug. 2026)
  • • glm-5.3-flash Deduktionsfaktor 5折 (50% Rabatt)-Aktion: 28. Aug. – 11. Sep. 2026
  • • Aktionsseite (Sep. 2026): unterstützt DeepSeek-V4-Pro/Flash 正式版, Doubao-Seed-2.1-Turbo, GLM-5.3, Auto — Aktionen ab 9,9¥ (zeitlich begrenzt)
  • • Der Coding Plan deckt auch Embedding-Modelle ab, u.a. Doubao Embedding Vision
  • • 1M Kontextfenster (laut Doku 1925114): doubao-seed-evolving, glm-5.3, glm-5.3-flash, kimi-k3, kimi-k2.8-preview, deepseek-v4.1-flash, deepseek-v4-flash, deepseek-v4-pro
  • • Kontingent-Refresh (Doku 1925114): 5-Stunden-Limit erneuert sich im 5-Stunden-Zyklus ab der ersten Anfrage, Wochenlimit wird montags 00:00:00 zurückgesetzt, Monatslimit am 1. Tag des Abo-Monats 00:00:00. Nach Erschöpfung erholt sich das Kontingent im nächsten Zyklus automatisch und verbraucht weder andere Ressourcenpakete noch das Account-Guthaben
  • • Erforderliche Base-URLs: https://ark.cn-beijing.volces.com/api/coding/v3 (OpenAI-kompatibel) oder https://ark.cn-beijing.volces.com/api/coding (Anthropic-kompatibel). Andere Modelle sind im Plan nicht nutzbar; ohne die richtige Base-URL greifen die Credits nicht und es können zusätzliche API-Kosten entstehen
  • • Credits gelten nur in AI-Coding-Tools — nicht für API-Aufrufe; die Nutzung von Coding-Plan-Base-URL/API-Key außerhalb kann als Missbrauch gewertet werden und Abo stoppen bzw. Account sperren
  • • Kontinuierliche Abrechnung (连续包月/连续包季/连续包年) verlängert monatlich/vierteljährlich/jährlich automatisch
  • • Einladungsprogramm: Einladender erhält 5% Gutschein (unbegrenzt), eingeladener Freund erhält beim Erstabonnement zusätzlich 9.5折 (5% Rabatt)
  • • Auto-Modus-Deduktionsfaktor = 1-Aktion: 10. Juni – 8. Nov. 2026
  • • Modell-Konfiguration (Doku 1925114, am 29. Sep. 2026 erneut geprüft): entweder den Model Name direkt setzen oder den Alias ark-code-latest verwenden und das Modell in der Konsole wechseln
  • • GLM-5.3 hat einen hohen Deduktionsfaktor (额度消耗较快) — nur für schwierige Aufgaben empfohlen; Thinking ist dauerhaft aktiv und nicht abschaltbar (ebenso Kimi-K3)
  • • DeepSeek-V4-Pro hat einen hohen Deduktionsfaktor (抵扣系数较高, 额度消耗较快) — nur für schwierige Aufgaben empfohlen; Thinking ist standardmäßig aktiv und kann abgeschaltet werden (Doku 1925114, aktualisiert 29. Sep. 2026)
Warp

Warp

Aktualisiert: 2026-10-05

US
Free
$0/Monat
Kostenlos, moderner Terminal, Warp-Agent-CLI-Zugriff, Reload-Credits 20% über Paid-Plan-Raten, BYOK, individually konfigurierbare Datenkontrollen, 10 Team-Mitglieder, 3 indexierte Codebasen, 30 Cloud-Conversations, bis 5 geteilte Sessions, begrenzter Cloud-Agent-Zugriff
BuildBeliebt
$20/Monat
$18/Monat jährlich
20$/Monat (18$/Monat jährlich). 1.500 Credits/Monat = 20$ zu API-Preisen, voller Agent-Zugriff auf Frontier- und Open-Source-Modelle, 10 Sitze, 20 parallele Cloud-Agents, 2 vCPU / 4 GiB, 40 Codebasen (100.000 Dateien)
Max
$200/Monat
$180/Monat jährlich
200$/Monat (180$/Monat jährlich). 18.000 Credits = 240$ inkludierte Nutzung, 12× Build, 10 Sitze, 4 vCPU / 8 GiB, 40 Codebasen, Volumenrabatte auf Reloads
Business
$50/Monat
$45/Monat jährlich
50$/Benutzer/Monat (45$/Benutzer/Monat jährlich), bis 25 Sitze, 1.500 Credits pro Sitz, Team-Nutzungsmetriken, eigene API-Keys & Custom-Inference-Endpunkte, 80 parallele Cloud-Agents, 8 vCPU / 16 GiB, 80 Codebasen, SAML SSO
Enterprise
Siehe Anbieter
Unbegrenzte Sitze, BYOLLM in eigener Cloud, Cloud-Agents selbst gehostet, gepoolte Credits, Custom Pricing, Analytics API, White-Glove-Onboarding, dedizierter Account-Manager & gemeinsamer Slack-Channel

LLM Modelle (22)

Claude Opus 5.5Claude Opus 5Claude Opus 4.8Claude Sonnet 5Claude Fable 5Claude Fable 5.1GPT-6-AstraGPT-6-SolGPT-6-LunaGPT-5.6GPT-5.5Gemini-3.1-ProGLM-5.2GLM-5.3-FlashKimi-K3Kimi-K2.7-CodeDeepSeek-V4-ProGrok-4.7Grok-4.6Gemini-3.7-FlashGemini-3.6-FlashGemini-3.5-Flash

Features

  • Moderner Terminal (Rust, GPU-beschleunigt)
  • Warp Agent: hochmoderne agentische Codings
  • Oz: Cloud-Agent-Orchestrierungsplattform (MIT)
  • BYOK (OpenAI, Anthropic, Google)
  • Universeller Prompt-Input (Befehle + natürliche Sprache)
  • Workflows: parametrisierte Befehlspipelines
  • Secret-Redaction mit benutzerdefinierten Regexes
  • SOC 2 Type II zertifiziert
  • Warp Factories (Early Access): Coding-Agent-Flotten in der Cloud
  • Cloud-Agents auf eigener Infrastruktur selbst hostbar

Hinweise

  • • Preisseite am 05.10.2026 erneut verifiziert (10% jährlicher Rabatt, Preise unverändert; die Monats- und Jahres-Kartenliste sind identisch): Free 0$, Build 20$/Monat (18$/Monat jährlich, 1.500 Credits = 20$ inkludierte Agent-Nutzung zu API-Preisen), Max 200$/Monat (180$/Monat jährlich, 18.000 Credits = 240$ inkludierte Nutzung, 12× Build), Business 50$/Benutzer/Monat (45$ jährlich, 1.500 Credits/Sitz, bis 25 Sitze), Enterprise individuell. Karteninhalte unverändert ggü. 01.10.: Free (moderner Terminal, Warp-Agent-CLI-Zugriff, Reload-Credits zu PAYG-Raten, eigene KI-Inferenz, begrenzter Cloud-Agent-Zugriff, beliebige Harness in der Cloud (Beta), individually konfigurierbare Datenkontrollen, begrenzter Warp-Drive- und Kollaborationszugriff, begrenzte Cloud-Conversation-Speicherung), Build (alles aus Free plus 1.500 Credits, voller Warp-Agent-Zugriff auf Frontier- und Open-Source-Modelle von OpenAI, Anthropic und z.ai, Reload-Credits mit Volumenrabatten/Auto-Reload/teamweiter Spend-Cap, erweiterter Cloud-Agent-Zugriff, höchste Codebase-Indexierungs-Limits, unbegrenzte Warp-Drive-Objekte und -Kollaboration, unbegrenzte Cloud-Conversation-Speicherung, privater E-Mail-Support), Max (18.000 Credits = 12× Build), Business (1.500 Credits pro Sitz, Team-Nutzungsmetriken, admin-konfigurierbare Datenkontrollen, BYOK und eigene Inference-Endpunkte, SAML-basierte SSO), Enterprise (unbegrenzte Sitze, individuelle gemeinsame Credit-Pools und Nutzungsbedingungen, erweiterte Spend-Kontrollen, Enterprise-Admin-Kontrollen und Data Governance, Enterprise Analytics API, Multi-Admin, BYOLLM in eigener Cloud, selbst gehostete Cloud-Agents, Custom-Codebase-Indexierung, Cross-Harness Agent Memory (Research Preview), White-Glove-Onboarding und Implementation Engineer, dedizierter Account-Manager und gemeinsamer Slack-Channel). Die Vergleichstabelle ist wieder im Text-Render enthalten, die Sitz-/Concurrency-/Indexierungs-Limits sind damit bestätigt: Sitze 10/10/10/25/unbegrenzt, parallele Cloud-Agents begrenzt/20/20/80/individuell, indexierte Codebasen 3/40/40/80, Dateien pro Codebase 3.000/100.000, Cloud-Conversation-Speicherung 30/unbegrenzt, Free-Reload-Credits 20% über Paid-Plan-Raten, Build 20$ = 1.500 Credits, Max 240$ = 18.000 Credits, Business 20$ pro Sitz = 1.500 Credits. Neu seit 01.10. und am 05.10.2026 unverändert: ein Warp-Factories-Abschnitt — jetzt in Early Access, mit eigener Stufenliste (Pay as you go = 20% Aufschlag, kein Abo; Build = bis zu 10 Sitze, Factory-Nutzung durch inkludierte Credits gedeckt, 20% Ersparnis gegenüber PAYG; Max = 12× Build inkludierte Factory-Nutzung, mehr Compute pro Cloud-Agent-Run; Business = bis zu 25 Sitze mit Credits pro Sitz, erweiterte Factory-Insights, SAML SSO, admin-konfigurierbare Datenkontrollen mit ZDR; Enterprise = unbegrenzte Sitze mit individuellen gemeinsamen Nutzungs-Pools, selbst gehostete Worker, eigener Code Forge, BYOLLM-Inferenz ohne Credit-Kosten, dedizierter Implementation Engineer). Ausgewählte Teams erhalten im Early Access bis zu 10.000$ Factory-Nutzung.
  • • Modelle am 05.10.2026 erneut verifiziert über docs.warp.dev/agents/inference/model-choice — die Modelliste ist unverändert, und die Seite trägt weiterhin den Revisionsstempel „Last updated Sep 24, 2026": Auto (Responsive/Cost-efficient/Genius/Open-weights), GPT-6 Astra/Sol/Luna, GPT-5.6 Sol/Terra/Luna, GPT-5.5, GPT-5.4, GPT-5.3 Codex, Claude Opus 5.5/5/4.8/4.7/4.6/4.5, Claude Sonnet 5/4.6/4.5, Claude Fable 5/5.1, Claude Haiku 4.5, Gemini 3.1 Pro + Flash 3.7/3.6/3.5, Grok 4.7/4.6/4.5/4.3, Grok Build 0.1, gehostet (Fireworks) GLM-5.3-Flash/5.2, Kimi K3/K2.7 Code/K2.6, Minimax 3, Qwen 3.8 Max, DeepSeek V4 Pro. Grok-Modelle lassen sich auch über ein eigenes SuperGrok-Abo statt über Warp-Credits nutzen. Claude Fable 5/5.1 erfordern Datenspeicherung und sind daher unter ZDR auf Enterprise standardmäßig deaktiviert. Alle Modelle haben konfigurierbare Reasoning-Level (low/medium/high/extra high/max) sowie eine Modell-Fallback-Kette, Custom-Router sind pro Agent Profile definierbar. Der Modell-Blick auf der Preisseite ist unverändert: „Fable 5, Claude Opus 5, GPT-5.6, Gemini 3.1 Pro, GLM 5.2, Kimi K3 und mehr". docs.warp.dev/billing/ ist ein 404 — die Billing-Fakten stehen auf der Preisseite und in den Inline-Credit-Bullets.
Windsurf (acquired by Cognition/Devin)

Windsurf (acquired by Cognition/Devin)

Aktualisiert: 2026-10-04

US
Free
$0/Monat
Kostenlos für alle, leichtes Agent-Kontingent, unbegrenzte Inline-Edits, unbegrenzte Tab-Vervollständigungen
ProBeliebt
$20/Monat
Höhere Kontingente, Zugang zu SWE-2, OpenAI/Claude/Gemini Frontier-Modellen, Cloud-Agents. SWE-2 kostenlos in Devin Desktop/CLI bis 16.10.2026
Max
$200/Monat
Höchste Kontingente, alle Frontier-Modelle, Devin Cloud, Bugbot
Teams
$80/Monat
80$/Monat Team + 40$/Monat pro Full-Dev-Sitz, unbegrenzt Flex-Sitze, geteilter Kontext, SAML/OIDC SSO, bis 200 Nutzer
Enterprise
Siehe Anbieter
Custom-Preis — Priority-Support, dediziertes Account-Management, SAML/OIDC SSO, Admin-Controls

LLM Modelle (11)

SWE-2Claude Opus 5Claude Opus 4.8Claude Sonnet 5GPT-5.4GPT-5.5Gemini-3.1-ProGemini-3.7-FlashClaude Haiku 4.5GPT-5.2-MiniKimi-K2.5

Features

  • KI-IDE mit Cascade Agentic-Flow
  • Multi-Model: SWE, GPT, Claude, Gemini
  • Cloud-Agents (Devin Cloud)
  • Bugbot Code-Reviews
  • Team-Marketplace
  • Agent Client Protocol (ACP)
  • Supercomplete Multi-Line-Vorhersagen
  • Fast Context Codebase-Suche

Hinweise

  • • Von Cognition übernommen. Leitet weiter zu Devin-Preisen. Free, Pro 20$/Monat, Max 200$/Monat, Teams 80$/Monat+40$/Sitz, Enterprise custom
  • • Gleichzeitige Sessions: Free 1, Pro 10, Max 10, Teams/Enterprise unbegrenzt
  • • Pro 20$: Zugang zu OpenAI-, Claude-, Gemini- und SpaceXAI-Frontier-Modellen und SWE 2, Cloud-Agents, Mehrverbrauch zu API-Preisen. SWE-2 kostenlos in Devin Desktop/CLI bis 16.10.2026
  • • Max 200$: deutlich höhere Kontingente, SWE-2 und führende Open-Source-Modelle kostenlos (Devin Desktop/CLI) bis 16.10.2026. Alte Windsurf-Pro-15$-Stufe eingestellt
  • • Teams 80$/Monat + 40$ pro Full-Dev-Sitz (unbegrenzt Flex-Sitze), bis 200 Nutzer, zentralisierte Abrechnung, Admin-Dashboard mit Analysen, Priority-Support
  • • Die Devin-Plantabelle listet außerdem DeepWiki, Devin API, Ask Devin und Teamspace-Isolation; Teamspace-Isolation und VPC-Deployment sind Enterprise-only
  • • Am 04.10.2026 erneut geprüft gegen devin.ai/pricing (windsurf.com/pricing leitet weiterhin hierher) — Free 0$, Pro 20$, Max 200$, Teams 80$+40$/Sitz, Enterprise custom unverändert; die Plantabelle weist nur noch vier Parallel-Session-Limits aus (Pro und Max bis 10, Teams und Enterprise unbegrenzt), für Free wird kein Wert mehr publiziert
Xiaomi MiMo

Xiaomi MiMo

Aktualisiert: 2026-10-05

CN
Lite
$5.28 Erster Monat
$6/Monat
$5/Monat jährlich
4,1B Credits/Monat (¥39/Monat). ~200 mittelschwere Aufgaben
Standard
$14.08 Erster Monat
$16/Monat
$14/Monat jährlich
11B Credits/Monat (¥99/Monat). ~1.600 mittelschwere Aufgaben
ProBeliebt
$44 Erster Monat
$50/Monat
$44/Monat jährlich
38B Credits/Monat (¥329/Monat). ~5.600 mittelschwere Aufgaben
Max
$88 Erster Monat
$100/Monat
$88/Monat jährlich
82B Credits/Monat (¥659/Monat). ~12.800 mittelschwere Aufgaben
Team Standard
$16/Monat
$14/Monat jährlich
Team-Edition, pro Seat. 11B Credits/Monat (¥99/Seat/Monat). Kein Rabatt auf den ersten Kauf
Team Pro
$50/Monat
$44/Monat jährlich
Team-Edition, pro Seat. 38B Credits/Monat (¥329/Seat/Monat). Kein Rabatt auf den ersten Kauf
Team Max
$100/Monat
$88/Monat jährlich
Team-Edition, pro Seat. 82B Credits/Monat (¥659/Seat/Monat). Kein Rabatt auf den ersten Kauf

LLM Modelle (8)

MiMo-V2.6-ProMiMo-V2.6-FlashMiMo-V2.5-ProMiMo-V2.5MiMo-V2.5-ASRMiMo-V2.5-TTSMiMo-V2.5-TTS-VoiceCloneMiMo-V2.5-TTS-VoiceDesign

Features

  • Token-basiertes Creditsystem
  • Individual- + Team-Edition (pro Seat)
  • Parallele Kontingentnutzung (1:2 Verhältnis)
  • Alle TTS/ASR-Modelle kostenlos (zeitlich begrenzt)
  • Cache-Treffer-Preis (10-120× günstiger)
  • 12% Rabatt auf den ersten Kauf (nur Individual)
  • 12% Rabatt auf Jahresabo
  • Nachtmodus 0,8× Verbrauch (UTC 16:00-24:00)

Hinweise

  • • Zwei Editionen: Individual (Lite/Standard/Pro/Max) und Team (Standard/Pro/Max, Preis pro Seat)
  • • Team-Edition bietet zentrale Seat-Verwaltung, Team-Nutzungskontrolle und -analyse sowie zentrale Abrechnung und Rechnungsstellung
  • • Credits werden basierend auf Token-Anzahl mit modellspezifischen Multiplikatoren verbraucht
  • • Die Kontingent-Regeln sind für Individual- und Team-Edition identisch
  • • Aufgabenrunden-Schätzungen basieren auf mimo-v2.6-flash; Jahrespläne bieten etwa das 12-Fache des Monatsumfangs
  • • MiMo-V2.6-Serie am 22. Sep. 2026 gestartet: mimo-v2.6-pro (Flagship) + mimo-v2.6-flash, nativ multimodal (Vision), gleiche API-Preise wie V2.5 — V2.6-Flash übertrifft V2.5-Pro
  • • MiMo-V2.6-Pro: 2,5/300/600 Credits pro Cache-Treffer/Input-Miss/Output-Token
  • • MiMo-V2.6-Flash: 2/100/200 Credits pro Cache-Treffer/Input-Miss/Output-Token
  • • Alle V2-Modelle werden seit 1. Juni 2026 automatisch auf V2.5-Äquivalente umgeleitet
  • • V2-Serie wird am 30. Juni 2026 vollständig eingestellt
  • • MiMo-V2.5-Pro und MiMo-V2.5 werden im Individual-Plan weiter unterstützt, aber am 21. Okt. 2026 10:00 (Peking) abgeschaltet — auf V2.6 umsteigen
  • • MiMo-V2.5-Pro: 2,5/300/600 Credits pro Cache-Treffer/Input-Miss/Output-Token
  • • MiMo-V2.5: 2/100/200 Credits pro Cache-Treffer/Input-Miss/Output-Token
  • • MiMo-V2.5-ASR: 30M Credits pro Stunde Audio-Input
  • • TTS-Modelle vorübergehend kostenlos (kein Credit-Verbrauch)
  • • Jahrespläne: 12% Rabatt gegenüber monatlicher Zahlung
  • • Jaheskontingente (Doku docs/en-US/price/token-plan, aktualisiert 21. Sep. 2026): Lite 49,2B, Standard 132B, Pro 456B, Max 984B Credits pro Jahr — also das 12-Fache des Monatskontingents; Team pro Seat: 132B / 456B / 984B
  • • Einführungspreis: 12% Rabatt auf ersten monatlichen Kauf
  • • Bei Kontingenterschöpfung wird der Dienst gestoppt (keine automatische Nachberechnung)
  • • Wenn das Kontingent aufgebraucht ist: Individual kauft ein Upgrade-Paket oder wechselt zur Standard-API (Pay-per-Token); Team kauft zusätzliche Seats und verteilt sie neu oder wechselt zur Standard-API
  • • Übersee: Singapur- und Europa-Cluster. China-Cluster erfordert +86
  • • Token-Plan-Base-URLs (je Cluster, am 2. Okt. 2026 geprüft): OpenAI-Protokoll https://token-plan-cn.xiaomimimo.com/v1 (China), https://token-plan-sgp.xiaomimimo.com/v1 (Singapur), https://token-plan-ams.xiaomimimo.com/v1 (Europa); jedes Cluster hat einen passenden /anthropic-Endpunkt für das Anthropic-Protokoll. API-Key-Format tp-xxxxx; maßgeblich ist die auf der Token-Plan-Seite angezeigte URL. Der Key gilt nur für die Laufzeit des gekauften Pakets
  • • Keine Rückerstattung: Das Abo wirkt sofort, weder der Tarif noch ungenutztes Kontingent werden erstattet. Ein Upgrade innerhalb des Plans per Preisdifferenz ist möglich (ungenutztes Kontingent wird anteilig umgerechnet), ein Downgrade nicht, und gleichzeitig kann nur ein Individual-Plan aktiv sein
Z.ai / GLM

Z.ai / GLM

Aktualisiert: 2026-10-05

CN
Lite
$12.6/Monat
~80 Prompts pro 5h~400 Prompts/Woche
MCP: Credit-basiert: Calls × Output-Multiplikator (1,2)
30% off promo: $12.6/mo (regular $18). Quarterly: $43.2/quarter (20% off list). Yearly: $151.2/year (30% off list). ~3x Claude Pro usage. 10,000 credits/week.
ProBeliebt
$56/Monat
~400 Prompts pro 5h~2.0K Prompts/Woche
MCP: Credit-basiert: Calls × Output-Multiplikator (1,2)
30% off promo: $56/mo (regular $80). Quarterly: $192/quarter (20% off list). Yearly: $672/year (30% off list). ~5x Lite usage. 6x Lite credits (60,000/week).
Max
$117.6/Monat
~1.6K Prompts pro 5h~8.0K Prompts/Woche
MCP: Credit-basiert: Calls × Output-Multiplikator (1,2)
30% off promo: $117.6/mo (regular $168). Quarterly: $403.2/quarter (20% off list). Yearly: $1,411.2/year (30% off list). ~4x Pro usage. 14x Lite credits (140,000/week).
Standard Seat
$88/Monat
$79/Monat jährlich
Team plan. 15,000 credits/5h, 66,000 credits/week. Seat & permission management, team analytics, centralized billing. Annual: $79.2/month (10% off).
Premium Seat
$188/Monat
$169/Monat jährlich
Team plan. 35,000 credits/5h, 155,000 credits/week. Early access to new models, priority resource allocation. Annual: $169.2/month (10% off).

LLM Modelle (2)

GLM-5.3GLM-5.3-Flash

Features

  • Vision MCP
  • Web-Suche MCP
  • Web-Reader MCP
  • Zread MCP
  • Empfehlungs-Credits (bis zu 20% zurück)
  • Daten werden nie zum Modelltraining verwendet (Team)

Hinweise

  • • Unterstützte Modelle: GLM-5.3, GLM-5.3-Flash — GLM-5.2/GLM-5.1-Anfragen werden automatisch zu GLM-5.3 geroutet, GLM-5-Turbo/GLM-4.7 zu GLM-5.3-Flash
  • • Credits 5h/Woche: Lite 2.000/10.000 · Pro 12.000/60.000 · Max 28.000/140.000
  • • Team-Sitz-Credits: Standard 15.000/5h & 66.000/Woche · Premium 35.000/5h & 155.000/Woche
  • • Credit-Multiplikatoren: GLM-5.3 (in 6.9, cached 1.7, out 24) · GLM-5.3-Flash (in 2.3, cached 0.56, out 8) · MCP-Tools (out 1,2)
  • • Modellnutzung außerhalb der Stoßzeiten: 50% Credit-Rate (Stoßzeiten Mo-Fr 14:00-18:00 UTC+8; Wochenenden ganztägig zum Off-Peak-Satz)
  • • Ganztägige Off-Peak-Aktion (25. Sep–7. Okt 2026): 50% Credit-Rate gilt den ganzen Tag
  • • Vierteljährliche Abrechnung: Lite 43,2$, Pro 192$, Max 403,2$ (20% Rabatt)
  • • Jährliche Abrechnung: Lite 151,2$, Pro 672$, Max 1.411,2$ (30% Rabatt)
  • • Team-Sitze: Standard 88$/Sitz/Monat (79,2$ jährlich), Premium 188$/Sitz/Monat (169,2$ jährlich)
  • • 30% Rabatt-Aktion (seit 1. August 2026): Lite 12,6$/Monat, Pro 56$/Monat, Max 117,6$/Monat (Liste 18$/80$/168$)
  • • GLM-5.3-Flash-Nutzungskampagne (3. Sep–7. Okt 2026): täglich 23:00-09:00 (UTC+8) unbegrenzt GLM-5.3-Flash über ZCode, doppeltes Credit-Kontingent für andere Agents
  • • Empfehlungsprogramm "Invite Friends, Earn Credits": bis zu 20% Credits zurück, unbegrenzt und ohne Ablauf
  • • Team-Sitze: mind. 2 Sitze, keine Obergrenze, Mitglied und Sitz 1:1; gemischte Standard/Premium-Käufe und Standard→Premium-Upgrades nicht unterstützt
  • • Team-On-Demand-Überziehung mit pro Mitglied einstellbaren Ausgabenlimits (zeitlich begrenzt: 10% Rabatt auf den Modell-API-Listenpreis); empfohlen 1-2 parallele Entwicklungsprojekte (Standard) / 2+ (Premium)
  • • Offiziell unterstützte Coding-Agent-Tools (Doku): ZCode (1,5x Nutzung), Claude Code, Claude for IDE, Codex, OpenCode, Pi, Cursor, Cline, TRAE, Qoder, Droid, Kilo Code, Roo Code, Crush, Goose, Eigent. General-Purpose-Agent-Tools (Best-Effort): AutoClaw (1,5x Nutzung), OpenClaw, Hermes Agent, SillyTavern. Abo-Leistungen dürfen nicht außerhalb dieses Umfangs genutzt werden
  • • Coding-Endpunkte: Anthropic Messages https://api.z.ai/api/anthropic, OpenAI Chat Completions https://api.z.ai/api/coding/paas/v4, OpenAI Responses https://api.z.ai/api/v1
  • • GLM-5.3 und GLM-5.3-Flash (= OX Alpha): bis zu 50% bessere Coding-Erfahrung als das Vorgängermodell, nutzbares 1M-Kontextfenster, validiert in 10.000+ realen Szenarien
  • • Internationale Registrierung auf z.ai (E-Mail/Google, kein +86). China-Nutzer: open.bigmodel.cn (erfordert +86)
Zencoder

Zencoder

Aktualisiert: 2026-10-05

US
Free
$0/Monat
Kostenlos, BYOK-only (eigene OpenAI/Anthropic/Gemini-Keys, verbraucht keine Credits). Alle Modelle. 7-Tage-Test mit 5.000 Credits
Pro
$45/Monat
$40/Monat jährlich
45$/Benutzer/Monat (40$ jährlich). 30.000 Credits/Monat, 2.000+ Integrationen, BYOK
Pro PlusBeliebt
$95/Monat
$85/Monat jährlich
95$/Benutzer/Monat (85$ jährlich). 80.000 Credits/Monat, gemeinsamer Team-Credit-Pool, SSO, Audit-Logs, Multi-Repo-Indexing
Pro Max
$195/Monat
$175/Monat jährlich
195$/Benutzer/Monat (175$ jährlich). 180.000 Credits/Monat, Priority-Support
Enterprise
Siehe Anbieter
Individuelle Preise. Vorausbezahlte Nutzungspläne, unbegrenztes Multi-Repo-Indexing, dedizierter CSM

LLM Modelle (14)

Grok-Code-Fast-1Claude Haiku 4.5AutoGemini-3.0-FlashGPT-5.4-miniGPT-5.3-CodexGemini-3.1-ProAuto+GPT-5.4Gemini-3.5-FlashClaude Sonnet 4.6Claude Opus 4.6Claude Opus 4.7GPT-5.5

Features

  • Repo-Grokking (vollständiges Codebase-Verständnis)
  • Zen Agents (anpassbare KI-Agenten)
  • Zentester (automatisiertes Testen)
  • CI/CD-Agenten für Automatisierung
  • Multi-Repository-Intelligenz
  • BYOK (Bring Your Own Key)
  • SOC 2 Type II, ISO 27001, ISO 42001
  • Credit-basierter Verbrauch
  • 2.000+ Integrationen
  • 70+ Programmiersprachen

Hinweise

  • • Preisseite + Docs-FAQ am 05.10.2026 erneut verifiziert — keine Preisänderungen: Pro 45$/Monat (40$ jährlich, 30.000 Credits/Sitz), Pro Plus 95$/Monat (85$ jährlich, 80.000 Credits, gemeinsamer Team-Credit-Pool mit Per-User-Caps, Multi-Repo-Indexing, Analytics-Dashboard, SSO & Audit-Logs), Pro Max 195$/Monat (175$ jährlich, 180.000 Credits, Priority-Support), Enterprise individuell (Vorausbezahlte Nutzungspläne, unbegrenztes Multi-Repo-Indexing, dedizierter CSM, privates Deployment, Professional Services). Free ist keine gelistete Karte, die Docs-Tabelle führt es mit 0$ und BYOK-only; Neukunden bekommen eine 7-Tage-Testversion mit 5.000 Credits, die nach 7 Tagen oder 5.000 Credits endet, und verbleibende Test-Credits werden nicht übernommen. Plan-Credits verfallen am Ende der Abrechnungsperiode und werden vor Top-ups verbraucht; Top-ups bleiben nutzbar, min. 20$, nicht erstattbar. Bezahlte Pläne teilen einen Org-Pool mit Per-User-Caps; BYOK auf allen Plänen inkl. Free verbraucht keine Credits (Sitzgebühr bleibt auf bezahlten Plänen fällig). Produkte als Zenflow Code + Zenflow Work gebrandet. Zahlungsmittel: alle gängigen Kreditkarten, Apple Pay, Link, Cash App, Klarna. Die Preisseite verlinkt jetzt eine vollständige Vergleichstabelle unter zencoder.ai/pricing/comparison-table, und ihre Feature-FAQ grenzt die Tarife ab: Team Management, SSO, Audit-Logs, Per-User-Credit-Caps und Usage-Analytics starten bei Pro Plus, Priority-Zugriff gibt es bei Pro Max und Enterprise, dedizierter Support und Onboarding nur bei Enterprise.
  • • Planwechsel mitten im Zyklus zuletzt am 03.10.2026 verifiziert; im Render vom 05.10. fehlen diese Abschnitte der Docs-FAQ wieder (die Überschriften „Team & Admin Controls" und „FAQ" kommen leer durch), das Detail bleibt daher bei der Lesart vom 03.10.: Upgrades werden anteilig abgerechnet (Sitzgebühr + Credit-Gutschrift) für den Rest des Zyklus, Downgrades greifen zum nächsten Abrechnungszeitraum, und das aktuelle Kontingent bleibt bis zum Ende des laufenden Zeitraums erhalten. Korrektur ggü. 01.10.: die zuvor aus dem Docs-Snapshot fehlenden Zusatzdetails sind wieder vorhanden — die 7-Tage-Kulanzfrist bei fehlgeschlagener Zahlung (erfordert mindestens eine vorherige erfolgreiche Zahlung; während der Kulanz bleiben Top-ups nutzbar, aber keine neuen Plan-Credits und keine neuen Top-ups, danach fällt der Account auf Free), die Mindest-Credit-Schwelle mancher Requests („You ran out of credits" trotz angezeigter Credits) und die Umverteilung von Per-User-Credit-Caps durch Admins mitten im Zyklus (verschiebt Caps innerhalb des Org-Pools, erzeugt oder vernichtet keine Credits). Neu ist außerdem: Kündigungs- und Downgrade-Verhalten sind ausformuliert (Kündigung = Wechsel auf Free am Ende des laufenden Abrechnungszeitraums, Plan-Credits verfallen, bestehende Top-ups bleiben nutzbar, danach BYOK-only), Credits sind nicht übertragbar und nicht in Bargeld einlösbar, und es gibt keine 1:1-Umrechnung von den alten LLM-Call-Zählungen auf Credits. Die Legacy-Tages-Call-Tabelle führt jetzt eine Spalte „New Plan“: Free 30 Calls/Tag → Free (BYOK), Starter 19$/17$ 280/Tag → Pro (45$/40$), Core 49$/44$ 750/Tag → Pro oder Pro Plus (45–95$), Advanced 119$/107$ 1.900/Tag → Pro Plus oder Pro Max, Max 250$/225$ 4.200/Tag → Pro Max (195$/175$), Enterprise individuell → Enterprise. Jahresverträge sind bis zur Verlängerung grandfathered, mit Kontakt rund 30 Tage davor; für die meisten Kunden steigt der Preis nicht, und für intensive Advanced-/Max-Nutzer ist das neue Äquivalent günstiger, aber credit-gemessen. Die Workflow-Tabelle zur Credit-Effizienz bewertet Auto als effizientesten Workflow, Fix a Bug und Multi-Model als effizient, Spec First als moderat, Requirements First als höher, Custom variabel.
  • • Credit-Multiplikatoren am 05.10.2026 erneut verifiziert (Docs-FAQ; alle Multiplikatoren und Request-Schätzungen unverändert, und die Tabelle führt jetzt zusätzlich je Modell eine typische Credits-pro-Request-Spanne und einen Durchschnitt — Grok Code Fast 1 10–50/30, Haiku 4.5 30–250/140, Auto 50–270/160, Gemini Flash 3.0 30–250/150, GPT-5.4-mini 50–260/220, GPT-5.3 Codex 30–650/300, Gemini Pro 3.1 100–650/500, Auto+ 125–800/600, GPT-5.4 100–700/550, Gemini Flash 3.5 weiterhin ohne Nutzungsdaten, Sonnet 4.6 100–700/580, Opus 4.6/4.7 150–1.300/1.200, GPT-5.5 300–1.600/1.450): Grok Code Fast 1 0,25x, Haiku 4.5 1x, Auto 1x, Gemini Flash 3.0 1x, GPT-5.4-mini 1,25x, GPT-5.3 Codex 2x, Gemini Pro 3.1 2x, Auto+ 2,5x, GPT-5.4 2,5x, Gemini Flash 3.5 2,5x (noch keine Nutzungsdaten), Sonnet 4.6 3x, Opus 4.6/4.7 5x, GPT-5.5 5x. Die Tabelle führt weiterhin monatliche Request-Schätzungen für Pro (30K), Pro Plus (80K) und Pro Max (180K): Grok Code Fast 1 ~1.000/2.660/6.000, Haiku 4.5 210/570/1.280, Auto 210/550/1.240, Gemini Flash 3.0 200/530/1.200, GPT-5.4-mini 135/360/810, GPT-5.3 Codex 100/265/600, Gemini Pro 3.1 60/160/360, Auto+ 50/130/300, GPT-5.4 54/145/325, Sonnet 4.6 50/135/310, Opus 4.6/4.7 25/65/150, GPT-5.5 20/55/124. Beispiel-Verbrauch XS → XL (Zencoder Auto 75→298, Auto+ 270→4.474, Gemini 3.5 Flash 398→4.497, Sonnet 4.6 142→4.451, Opus 4.7 304→7.717, GPT-5.5 456→6.299) sowie die S/M/L-Aufgabentabellen sind unverändert; die Benchmarks liefen auf einer Fullstack-App mit ~50.000 Zeilen (Python/FastAPI + React/TypeScript).

Modell-Kategorien erklärtModel Tiers Explained

Verstehe die Fähigkeitsstufen der AI ModelleUnderstanding the capability levels of AI models

Opus-LevelOpus-Level

Hochleistungs-Modelle für komplexes Reasoning, mehrstufige Aufgaben und fortgeschrittene Code-Generierung. Für anspruchsvolle Probleme.Highest capability models for complex reasoning, multi-step tasks, and advanced code generation. Best for challenging problems.

Beispiele: GLM-5.1, Claude Opus, MiniMax-M2.5Examples: GLM-5.1, Claude Opus, MiniMax-M2.5

Sonnet-LevelSonnet-Level

Ausbalancierte Modelle mit großartiger Performance für tägliche Entwicklungsaufgaben. Ideal für die meisten Coding-Workflows.Balanced models offering great performance for daily development tasks. Ideal for most coding workflows.

Beispiele: GLM-4.7, Claude Sonnet, qwen3.5-plusExamples: GLM-4.7, Claude Sonnet, qwen3.5-plus

Haiku-LevelHaiku-Level

Schnelle, effiziente Modelle für schnelle Aufgaben, Vervollständigungen und einfache Anfragen. Kosteneffektiv für hohe Nutzung.Fast, efficient models for quick tasks, completions, and simple queries. Cost-effective for high-volume usage.

Beispiele: GLM-4.5-Air, Claude HaikuExamples: GLM-4.5-Air, Claude Haiku

LLM Leistung

Ranking der LLMs nach Intelligence Index – Daten von artificialanalysis.ai

#ModellIntelligence Index
1Claude Opus 5.5 (Max, Default Fallback)
Anthropic
57.6
2Claude Sonnet 5.5 (Max, Default Fallback)
Anthropic
56.0
3Claude Opus 5.5 (Xhigh, Default Fallback)
Anthropic
56.0
4Claude Opus 5.5 (High, Default Fallback)
Anthropic
53.6
5Claude Fable 5.1 (Max, Default Fallback)
Anthropic
53.4
6Claude Fable 5.1 (Xhigh, Default Fallback)
Anthropic
53.2
7GPT-6 Astra (Max)
OpenAI
52.7
8Gemini 4 Argon (High)
Google
52.6
9GPT-6 Astra (Xhigh)
OpenAI
52.4
10Claude Sonnet 5.5 (Xhigh, Default Fallback)
Anthropic
51.9
11GPT-6.1 Sol (Max)
OpenAI
51.8
12Claude Fable 5.1 (High, Default Fallback)
Anthropic
51.2
13Claude Opus 5.5 (Medium, Default Fallback)
Anthropic
51.2
14GPT-6.1 Sol (Xhigh)
OpenAI
51.0
15GPT-6 Astra (High)
OpenAI
50.9
16Claude Opus 5 (Max)
Anthropic
50.8
17GPT-6.1 Sol (High)
OpenAI
50.2
18Claude Opus 5 (Xhigh)
Anthropic
49.7
19Claude Fable 5 (Max, Opus 4.8 Fallback)
Anthropic
49.6
20GPT-6 Astra (Medium)
OpenAI
49.6
21Claude Fable 5.1 (Medium, Default Fallback)
Anthropic
48.9
22Claude Opus 5 (High)
Anthropic
48.1
23Muse Spark 1.3 (Max)
Meta
48.1
24GPT-6.1 Sol (Medium)
OpenAI
47.8
25GPT-6 Sol (Max)
OpenAI
47.6
26GPT-5.6 Sol (Max)
OpenAI
47.0
27Claude Fable 5.1 (Low, Default Fallback)
Anthropic
46.8
28Claude Sonnet 5.5 (High, Default Fallback)
Anthropic
46.8
29Grok 4.7 (Xhigh)
SpaceXAI
46.4
30MiMo-V2.6-Pro
Xiaomi
46.3
31Grok 4.7 (High)
SpaceXAI
46.3
32GPT-6 Astra (Low)
OpenAI
45.8
33Qwen3.8 Max (0902)
Alibaba
45.4
34Muse Spark 1.3 (Xhigh)
Meta
45.1
35GLM-5.3 (Max)
Z AI
44.8
36Claude Opus 5 (Medium)
Anthropic
44.8
37Grok 4.6 (High)
SpaceXAI
44.3
38Grok 4.6 (Xhigh)
SpaceXAI
44.2
39GPT-6 Sol (Xhigh)
OpenAI
44.2
40GPT-5.6 Sol (Xhigh)
OpenAI
44.0
41Step 5 Preview
StepFun
43.7
42Kimi K3 (Max)
Kimi
43.6
43Grok 4.6 (Medium)
SpaceXAI
42.8
44GPT-6 Sol (High)
OpenAI
42.4
45Claude Opus 5.5 (Low, Default Fallback)
Anthropic
42.3
46GPT-5.6 Sol (High)
OpenAI
42.3
47Grok 4.7 (Low)
SpaceXAI
42.2
48GPT-5.6 Terra (Max)
OpenAI
42.1
49GPT-6.1 Sol (Low)
OpenAI
42.1
50GLM 5.3 Flash
Z AI
41.8
51Claude Opus 4.8 (Max)
Anthropic
41.8
52Ling 3.1 Flash
InclusionAI
41.1
53Gemini 3.8 Flash (High)
Google
40.9
54Claude Sonnet 5.5 (Medium, Default Fallback)
Anthropic
40.8
55Claude Opus 4.7 (Max)
Anthropic
40.7
56Qwen3.8 Max
Alibaba
40.2
57Qwen3.8 2.4T A95B
Alibaba
39.9
58Gemini 3.8 Flash (Medium)
Google
39.8
59GPT-6 Sol (Medium)
OpenAI
39.8
60Qwen3.8-Flash-Next
Alibaba
39.8
61Muse Spark 1.2 (Xhigh)
Meta
39.6
62Gemini 3.7 Flash (Medium)
Google
39.6
63DeepSeek V4.1 Flash (Max)
DeepSeek
39.5
64Claude Opus 5 (Low)
Anthropic
39.4
65GPT-5.6 Sol (Medium)
OpenAI
39.2
66Gemini 3.7 Flash (High)
Google
39.1
67GPT-5.4 (Xhigh)
OpenAI
39.0
68Grok 4.5 (High)
SpaceXAI
38.8
69GPT-5.5 (Xhigh)
OpenAI
38.4
70Claude Sonnet 5 (Max)
Anthropic
38.2
71GPT-6 Luna (Max)
OpenAI
38.1
72GPT-5.6 Terra (Xhigh)
OpenAI
38.0
73MiMo-V2.6-Flash
Xiaomi
37.9
74GPT-5.6 Luna (Max)
OpenAI
37.3
75GPT-5.5 (High)
OpenAI
37.0
76Gemini 3.7 Flash (Low)
Google
36.9
77DeepSeek V4 Pro 0813 (Max)
DeepSeek
36.0
78Claude Sonnet 5.5 (Low, Default Fallback)
Anthropic
35.9
79Grok 4.6 (Low)
SpaceXAI
35.1
80DeepSeek V4 Flash Vision (Max)
DeepSeek
34.8
81GPT-6 Luna (Xhigh)
OpenAI
34.6
82GPT-5.6 Luna (Xhigh)
OpenAI
34.6
83Claude Sonnet 5 (Xhigh)
Anthropic
34.4
84GLM-5.3 (Low)
Z AI
34.3
85DeepSeek V4 Flash 0731 (Max)
DeepSeek
34.3
86GPT-6 Sol (Low)
OpenAI
34.2
87GPT-5.6 Terra (High)
OpenAI
34.2
88Gemini 3.6 Flash (High)
Google
34.0
89JT-4.1 Flash 236B A21B (Reasoning)
China Mobile
33.9
90GPT-5.5 (Medium)
OpenAI
33.8
91Qwen3.8 27B (Xhigh)
Alibaba
33.7
92Muse Spark 1.1 (Xhigh)
Meta
33.7
93GLM-5.2 (Max)
Z AI
33.7
94Gemini 3.5 Flash (Medium)
Google
33.6
95Motif 3
Motif Technologies
33.6
96GPT-5.6 Sol (Low)
OpenAI
33.5
97Gemini 3.8 Flash (Low)
Google
33.5
98GPT-6 Luna (High)
OpenAI
32.9
99Gemini 3.5 Flash (High)
Google
32.6
100GPT-5.3 Codex (Xhigh)
OpenAI
32.5
101Motif 3 (Beta)
Motif Technologies
32.3
102GPT-5.6 Luna (High)
OpenAI
32.1
103Claude Opus 4.6 (Max)
Anthropic
31.9
104Claude Sonnet 5 (High)
Anthropic
31.7
105Muse Spark
Meta
31.3
106Claude Opus 4.7 (Non-reasoning, High)
Anthropic
30.9
107GPT-5.5 (Low)
OpenAI
30.7
108K2 Horizon 375B A23B
Institute of Foundation Models
30.5
109GPT-5.2 (Xhigh)
OpenAI
30.4
110DeepSeek V4 Pro 0424 (Max)
DeepSeek
30.4
111GPT-5.6 Terra (Medium)
OpenAI
30.1
112Kimi K3 (Low)
Kimi
30.1
113DeepSeek V4 Pro 0424 (High)
DeepSeek
30.1
114Claude Sonnet 4.6 (Max)
Anthropic
30.1
115GPT-6 Luna (Medium)
OpenAI
29.9
116Gemini 3.1 Pro Preview
Google
29.7
117Qwen3.7 Max
Alibaba
29.5
118MiniMax-M3
MiniMax
29.2
119Claude Opus 4.5 (Reasoning)
Anthropic
29.1
120MiMo-V2-Pro
Xiaomi
28.6
121GPT-5.2 Codex (Xhigh)
OpenAI
28.5
122GPT-6 Sol (Non-reasoning)
OpenAI
28.5
123Qwen3.6 Max Preview
Alibaba
28.4
124GPT-5.6 Sol (Non-reasoning)
OpenAI
28.3
125Solar Pro 4
Upstage
28.2
126Nex-N2-Pro (Based on Qwen3.5-397B-A17B)
Nex AGI
28.2
127Claude Sonnet 5 (Medium)
Anthropic
28.1
128Gemini 3 Pro Preview (High)
Google
28.0
129GLM-5 (Reasoning)
Z AI
27.9
130GPT-5.4 (Low)
OpenAI
27.6
131Qwen3.8 27B (Medium)
Alibaba
27.6
132GPT-5.6 Terra (Low)
OpenAI
27.5
133JT-4.1 Flash 236B A21B (Non-reasoning)
China Mobile
27.3
134Grok Build 0.1 0616
SpaceXAI
27.2
135Kimi K2.6 (Reasoning)
Kimi
27.0
136Qwen3.6 Plus
Alibaba
27.0
137Quasar 438B (Max, Based on GLM-5.2)
Multiverse Computing
26.7
138GLM-5-Turbo
Z AI
26.6
139GPT-5.2 (Medium)
OpenAI
26.5
140Apodex 1.1
Apodex
26.4
141Claude Opus 4.6 (Non-reasoning, High)
Anthropic
26.4
142Gemini 3 Flash Preview (Reasoning)
Google
26.3
143Qwen3.8 27B (Low)
Alibaba
26.2
144GLM-5.1 (Reasoning)
Z AI
26.1
145MiMo-V2.5-Pro (Reasoning)
Xiaomi
26.0
146GPT-5.5 Instant (June 2026)
OpenAI
26.0
147Kimi K2.7 Code
Kimi
25.8
148Inkling Small
Thinking Machines
25.7
149Grok 4.20 0309 v2 (Reasoning)
SpaceXAI
25.7
150K2 Horizon MoVA 36B A4B
Institute of Foundation Models
25.3
151Hy3
Tencent
25.3
152Grok 4.20 0309 (Reasoning)
SpaceXAI
25.2
153MiMo-V2.5
Xiaomi
25.2
154Qwen3.7 Plus
Alibaba
25.2
155MiMo-V2-Omni-0327
Xiaomi
25.1
156Inkling (Xhigh)
Thinking Machines
25.0
157GPT-5.6 Luna (Medium)
OpenAI
25.0
158GPT-5 Codex (High)
OpenAI
24.9
159Grok 4.3 (High)
SpaceXAI
24.9
160Grok 4.3 (Medium)
SpaceXAI
24.8
161Claude Sonnet 4.6 (Non-reasoning, High)
Anthropic
24.7
162GPT-5.1 (High)
OpenAI
24.7
163DeepSeek V4.1 Flash (Non-reasoning)
DeepSeek
24.7
164Solar Open2 250B
Upstage
24.7
165Ling-3.0-flash-VL
InclusionAI
24.6
166DeepSeek V4 Flash 0420 (High)
DeepSeek
24.4
167Claude Sonnet 5 (Low)
Anthropic
24.3
168Grok 4.3 (Low)
SpaceXAI
24.3
169GLM-5.1 (Non-reasoning)
Z AI
24.2
170DeepSeek V4 Flash 0420 (Max)
DeepSeek
24.2
171Solar Mini 4
Upstage
24.1
172GPT-5.4 mini (Xhigh)
OpenAI
24.1
173MiMo-V2-Omni
Xiaomi
23.9
174Gemini 3.5 Flash (Minimal)
Google
23.8
175GPT-5.1 Codex (High)
OpenAI
23.7
176Claude Opus 4.5 (Non-reasoning)
Anthropic
23.7
177Kimi K2.6 (Non-reasoning)
Kimi
23.6
178GLM 5V Turbo (Reasoning)
Z AI
23.5
179Kimi K2.5 (Reasoning)
Kimi
23.5
180Claude Sonnet 4.6 (Non-reasoning, Low)
Anthropic
23.3
181GPT-5.5 (Non-reasoning)
OpenAI
23.2
182Claude Sonnet 5 (Non-reasoning, High)
Anthropic
23.2
183GPT-5 (High)
OpenAI
23.0
184Qwen3.5 27B (Reasoning)
Alibaba
22.9
185Nemotron 3 Ultra 550B A55B (Reasoning)
NVIDIA
22.9
186GPT-5 (Medium)
OpenAI
22.9
187MiniMax-M2.5
MiniMax
22.8
188MiniMax-M2.7
MiniMax
22.8
189Claude 4.1 Opus (Reasoning)
Anthropic
22.8
190A.X-K2
SK Telecom
22.7
191Hy3-preview (Reasoning)
Tencent
22.7
192GPT-5.5 Instant (May 2026)
OpenAI
22.7
193Ling-3.0-flash-Fin
InclusionAI
22.6
194Grok 4
SpaceXAI
22.5
195MiMo-V2-Flash (Feb 2026)
Xiaomi
22.4
196GLM-5.2 (Non-reasoning)
Z AI
22.4
197Gemini 3 Pro Preview (Low)
Google
22.3
198Gemini 3.5 Flash-Lite
Google
22.2
199GLM-4.7 (Reasoning)
Z AI
22.2
200Kimi K2 Thinking
Kimi
22.0
201o3-pro
OpenAI
21.9
202G9v3-39A5B
AI9Stars
21.8
203GLM-5 (Non-reasoning)
Z AI
21.8
204KAT Coder Pro V2
KwaiKAT
21.7
205GPT-6 Luna (Low)
OpenAI
21.5
206DeepSeek V3.2 (Reasoning)
DeepSeek
21.5
207Qwen3.5 397B A17B (Non-reasoning)
Alibaba
21.4
208Qwen3.6 27B (Reasoning)
Alibaba
21.4
209Qwen3 Max Thinking
Alibaba
21.3
210GPT-5.6 Luna (Low)
OpenAI
21.0
211MiniMax-M2.1
MiniMax
20.9
212DeepSeek V4 Pro 0424 (Non-reasoning)
DeepSeek
20.8
213GPT-5 (Low)
OpenAI
20.8
214GPT-5.6 Terra (Non-reasoning)
OpenAI
20.8
215MiMo-V2-Flash (Reasoning)
Xiaomi
20.8
216Claude 4.5 Sonnet (Reasoning)
Anthropic
20.7
217GPT-5.4 nano (Xhigh)
OpenAI
20.7
218K2 Horizon 7B
Institute of Foundation Models
20.6
219Claude 4 Opus (Reasoning)
Anthropic
20.6
220GPT-5 mini (Medium)
OpenAI
20.6
221Qwen3.5 Omni Plus
Alibaba
20.4
222Grok 4.1 Fast (Reasoning)
SpaceXAI
20.4
223DeepSeek V4 Pro 0813 (Non-reasoning)
DeepSeek
20.4
224GPT-5.1 Codex mini (High)
OpenAI
20.4
225o3
OpenAI
20.2
226Qwen3.8 27B (Non-reasoning)
Alibaba
20.2
227Ling 3.0 Flash
InclusionAI
20.1
228GPT-5.4 nano (Medium)
OpenAI
20.0
229Qwen3.6 27B (Non-reasoning)
Alibaba
19.8
230K-EXAONE 2.0 0803
LG AI Research
19.7
231GPT-5.4 mini (Medium)
OpenAI
19.7
232Step 3.7 Flash
StepFun
19.5
233Qwen3.5 27B (Non-reasoning)
Alibaba
19.4
234Kimi K2.5 (Non-reasoning)
Kimi
19.4
235Qwen3.5 35B A3B (Reasoning)
Alibaba
19.3
236Claude 4.5 Sonnet (Non-reasoning)
Anthropic
19.3
237LongCat 2.0
LongCat
19.1
238Claude 4 Sonnet (Reasoning)
Anthropic
18.9
239DeepSeek V4 Flash 0420 (Non-reasoning)
DeepSeek
18.9
240JT-35B-Flash
China Mobile
18.7
241Claude 4.1 Opus (Non-reasoning)
Anthropic
18.6
242MiniMax-M2
MiniMax
18.6
243KAT-Coder-Pro V1
KwaiKAT
18.6
244GPT-6 Luna (Non-reasoning)
OpenAI
18.5
245GLM-4.6 (Reasoning)
Z AI
18.5
246Qwen3.5 397B A17B (Reasoning)
Alibaba
18.4
247MiMo-V2.5-Pro (Non-reasoning)
Xiaomi
18.3
248GPT-5.4 (Non-reasoning)
OpenAI
18.2
249Qwen3.6 35B A3B (Reasoning)
Alibaba
18.2
250Grok 4 Fast (Reasoning)
SpaceXAI
17.9
251Gemini 3 Flash Preview (Non-reasoning)
Google
17.9
252Qwen3.5 122B A10B (Non-reasoning)
Alibaba
17.7
253Claude 3.7 Sonnet (Reasoning)
Anthropic
17.7
254Muse Glimmer (High)
Meta
17.5
255GLM-4.7 (Non-reasoning)
Z AI
17.4
256Step 3.5 Flash 2603
StepFun
17.0
257Ling-2.6-1T
InclusionAI
17.0
258GPT-5.2 (Non-reasoning)
OpenAI
17.0
259Hy3-preview (Non-reasoning)
Tencent
17.0
260Doubao Seed Code
ByteDance Seed
16.9
261Claude 4.5 Haiku (Reasoning)
Anthropic
16.9
262GPT-5 mini (High)
OpenAI
16.8
263Gemma 4 26B A4B (Reasoning)
Google
16.7
264o4-mini (High)
OpenAI
16.7
265Claude 4 Opus (Non-reasoning)
Anthropic
16.6
266DeepSeek V3.2 Exp (Reasoning)
DeepSeek
16.6
267Step 3.5 Flash
StepFun
16.6
268Claude 4 Sonnet (Non-reasoning)
Anthropic
16.6
269Ring-2.6-1T
InclusionAI
16.6
270Qwen3 Max Thinking (Preview)
Alibaba
16.3
271Gemini 2.5 Pro
Google
16.1
272DeepSeek V3.2 (Non-reasoning)
DeepSeek
16.0
273MiMo-V2-Flash (Non-reasoning)
Xiaomi
16.0
274Qwen3.5 122B A10B (Reasoning)
Alibaba
15.6
275K2 Horizon 3.7B
Institute of Foundation Models
15.6
276Gemini 3.1 Flash-Lite
Google
15.6
277Qwen3 Max
Alibaba
15.6
278Gemini 2.5 Flash Preview (Sep '25) (Reasoning)
Google
15.5
279GPT-5.6 Luna (Non-reasoning)
OpenAI
15.5
280Claude 4.5 Haiku (Non-reasoning)
Anthropic
15.4
281Kimi K2 0905
Kimi
15.3
282Claude 3.7 Sonnet (Non-reasoning)
Anthropic
15.3
283o1
OpenAI
15.2
284Qwen3.6 35B A3B (Non-reasoning)
Alibaba
15.2
285Qwen3.5 35B A3B (Non-reasoning)
Alibaba
15.1
286Gemini 2.5 Pro Preview (Mar' 25)
Google
15.0
287GLM-4.7-Flash (Reasoning)
Z AI
14.9
288GLM-4.6 (Non-reasoning)
Z AI
14.9
289DeepSeek V3.1 Terminus (Reasoning)
DeepSeek
14.8
290Granite 4.2 30B
IBM
14.8
291Gemma 4 31B (Reasoning)
Google
14.7
292Grok 4.20 0309 (Non-reasoning)
SpaceXAI
14.6
293Grok 3 mini Reasoning (High)
SpaceXAI
14.6
294Gemini 2.5 Pro Preview (May' 25)
Google
14.5
295DeepSeek V3.2 Speciale
DeepSeek
14.5
296K-EXAONE (Reasoning)
LG AI Research
14.4
297ERNIE 5.0 Thinking Preview
Baidu
14.3
298Nova 2.0 Pro Preview (Medium)
Amazon
14.2
299Grok 4.20 0309 v2 (Non-reasoning)
SpaceXAI
14.2
300Mistral Medium 3.5
Mistral
14.2
301Gemma 4 12B (Reasoning)
Google
14.2
302Grok Code Fast 1
SpaceXAI
14.1
303Grok 4.3 (Non-reasoning)
SpaceXAI
14.0
304DeepSeek V3.2 Exp (Non-reasoning)
DeepSeek
13.9
305Gemma 4 31B (Non-reasoning)
Google
13.9
306DeepSeek V3.1 Terminus (Non-reasoning)
DeepSeek
13.9
307Mercury 2
Inception
13.8
308Apriel-v1.5-15B-Thinker
ServiceNow
13.8
309DeepSeek V3.1 (Non-reasoning)
DeepSeek
13.7
310Nova 2.0 Omni (Medium)
Amazon
13.6
311DeepSeek V3.1 (Reasoning)
DeepSeek
13.5
312Nova 2.0 Lite (High)
Amazon
13.4
313Apriel-v1.6-15B-Thinker
ServiceNow
13.4
314Qwen3 VL 235B A22B (Reasoning)
Alibaba
13.4
315Qwen3.5 9B (Non-reasoning)
Alibaba
13.3
316GPT-5.1 (Non-reasoning)
OpenAI
13.3
317EXAONE 4.5 33B (Reasoning)
LG AI Research
13.2
318Gemini 2.5 Flash (Reasoning)
Google
13.1
319Command A+
Cohere
13.1
320Qwen3.5 4B (Reasoning)
Alibaba
13.1
321Gemma 4 26B A4B (Non-reasoning)
Google
13.1
322DeepSeek R1 0528 (May '25)
DeepSeek
13.1
323GPT-5 nano (High)
OpenAI
13.0
324Nemotron 3.5 Lightning
NVIDIA
12.9
325GLM-4.5 (Reasoning)
Z AI
12.8
326Nemotron 3 Super 120B A12B (Reasoning)
NVIDIA
12.8
327Nova 2.0 Pro Preview (Low)
Amazon
12.8
328GPT-4.1
OpenAI
12.7
329Kimi K2
Kimi
12.7
330Qwen3 235B A22B 2507 (Reasoning)
Alibaba
12.7
331Qwen3 Max (Preview)
Alibaba
12.6
332o3-mini
OpenAI
12.5
333MiniCPM5-2B
OpenBMB
12.5
334Qwen3.5 Omni Flash
Alibaba
12.5
335GPT-5 nano (Medium)
OpenAI
12.5
336Nova 2.0 Lite (Medium)
Amazon
12.5
337Gemini 2.5 Flash Preview (Sep '25) (Non-reasoning)
Google
12.4
338o1-pro
OpenAI
12.4
339Mercury 2.5
Inception
12.3
340JT-MINI
China Mobile
12.2
341Grok 3
SpaceXAI
12.1
342Seed-OSS-36B-Instruct
ByteDance Seed
12.1
343Qwen3 235B A22B 2507 Instruct
Alibaba
12.0
344Qwen3 Coder 480B A35B Instruct
Alibaba
11.9
345Qwen3 VL 32B (Reasoning)
Alibaba
11.9
346Sonar Reasoning Pro
Perplexity
11.8
347Nova 2.0 Lite (Low)
Amazon
11.8
348Magistral Medium 1.2
Mistral
11.8
349HyperNova 60B 2605 (High, Based on gpt-oss-120b)
Multiverse Computing
11.7
350Gemini 2.5 Flash Preview (Reasoning)
Google
11.7
351Nemotron Cascade 2 30B A3B
NVIDIA
11.7
352MiniMax M1 80k
MiniMax
11.7
353GPT-5.4 nano (Non-reasoning)
OpenAI
11.7
354gpt-oss-120b (High)
OpenAI
11.6
355K2 Think V2
Institute of Foundation Models
11.5
356LongCat Flash Lite
LongCat
11.5
357o1-preview
OpenAI
11.4
358DeepSeek R1 (Jan '25)
DeepSeek
11.4
359HyperCLOVA X SEED Think (32B)
Naver
11.4
360GPT-5 (Minimal)
OpenAI
11.4
361Mistral Small 4 (Reasoning)
Mistral
11.3
362Grok 4.1 Fast (Non-reasoning)
SpaceXAI
11.3
363Qwen3.5 9B (Reasoning)
Alibaba
11.2
364K-EXAONE (Non-reasoning)
LG AI Research
11.2
365Qwen3 Next 80B A3B (Reasoning)
Alibaba
11.2
366GLM-4.6V (Reasoning)
Z AI
11.2
367Grok 4 Fast (Non-reasoning)
SpaceXAI
11.1
368GLM-4.5-Air
Z AI
11.1
369Ling 3.0 Tiny
InclusionAI
11.1
370Granite 4.2 8B
IBM
11.1
371GPT-5.4 mini (Non-reasoning)
OpenAI
11.1
372Nova 2.0 Omni (Low)
Amazon
11.1
373o3-mini (High)
OpenAI
11.0
374Mi:dm K 2.5 Pro
Korea Telecom
11.0
375Ring-1T
InclusionAI
10.9
376G9v3-3B
AI9Stars
10.8
377Qwen3.5 4B (Non-reasoning)
Alibaba
10.8
378Trinity Large Thinking
Arcee AI
10.8
379INTELLECT-3 (Based on GLM-4.5-Air)
Prime Intellect
10.6
380GLM-4.7-Flash (Non-reasoning)
Z AI
10.6
381Solar Open 100B (Reasoning)
Upstage
10.4
382Gemini 2.5 Flash-Lite Preview (Sep '25) (Reasoning)
Google
10.4
383GPT-5 (ChatGPT)
OpenAI
10.4
384Grok 3 Reasoning Beta
SpaceXAI
10.4
385Nemotron 3 Nano Omni 30B A3B Reasoning
NVIDIA
10.3
386GPT-4.1 mini
OpenAI
10.2
387gpt-oss-120b (Low)
OpenAI
10.2
388gpt-oss-20b (Low)
OpenAI
10.0
389MiniMax M1 40k
MiniMax
10.0
390Llama 4 Maverick
Meta
10.0
391Nova 2.0 Pro Preview (Non-reasoning)
Amazon
10.0
392North Mini Code
Cohere
9.9
393Gemini 2.5 Flash (Non-reasoning)
Google
9.9
394K2-V2 (High)
Institute of Foundation Models
9.9
395GPT-5 mini (Minimal)
OpenAI
9.9
396Qwen3 VL 235B A22B Instruct
Alibaba
9.9
397Qwen3 30B A3B 2507 (Reasoning)
Alibaba
9.8
398o1-mini
OpenAI
9.8
399DeepSeek V3 0324
DeepSeek
9.7
400Ling 2.6 Flash
InclusionAI
9.7
401Qwen3 Next 80B A3B Instruct
Alibaba
9.6
402GPT-4.5 (Preview)
OpenAI
9.6
403Tri-21B-think Preview
Trillion Labs
9.6
404Qwen3 Coder 30B A3B Instruct
Alibaba
9.6
405Qwen3 235B A22B (Reasoning)
Alibaba
9.5
406DiffusionGemma 26B A4B
Google
9.5
407Qwen3 VL 30B A3B (Reasoning)
Alibaba
9.5
408QwQ 32B
Alibaba
9.5
409Gemma 4 12B (Non-reasoning)
Google
9.4
410Gemini 2.0 Flash Thinking Experimental (Jan '25)
Google
9.4
411Mistral Large 3
Mistral
9.3
412Gemini 2.5 Flash-Lite Preview (Sep '25) (Non-reasoning)
Google
9.3
413Mistral Medium 3.1
Mistral
9.2
414Ling-1T
InclusionAI
9.2
415Motif-2-12.7B-Reasoning
Motif Technologies
9.2
416Nova Premier
Amazon
9.2
417Qwen3 Coder Next
Alibaba
9.2
418Granite 4.2 3B
IBM
9.1
419Magistral Medium 1
Mistral
9.1
420Solar Pro 2 (Preview) (Reasoning)
Upstage
9.1
421Mistral Small 4 (Non-reasoning)
Mistral
9.0
422gpt-oss-20b (High)
OpenAI
9.0
423GPT-4o (March 2025, chatgpt-4o-latest)
OpenAI
9.0
424Mistral Medium 3
Mistral
9.0
425Tri-21B-Think
Trillion Labs
9.0
426Devstral Medium
Mistral
9.0
427K2-V2 (Medium)
Institute of Foundation Models
9.0
428Llama Nemotron Super 49B v1.5 (Reasoning)
NVIDIA
9.0
429Claude 3.5 Haiku
Anthropic
8.9
430Llama 3.3 Nemotron Super 49B v1 (Reasoning)
NVIDIA
8.9
431NVIDIA Nemotron 3 Nano 30B A3B (Reasoning)
NVIDIA
8.9
432Gemini 2.0 Flash (Feb '25)
Google
8.9
433Gemma 4 E4B (Reasoning)
Google
8.9
434Qwen3 4B 2507 (Reasoning)
Alibaba
8.8
435Sarvam 105B (High)
Sarvam
8.8
436MiniCPM5-1B (Reasoning)
OpenBMB
8.8
437Sonar Reasoning
Perplexity
8.7
438Gemini 2.5 Flash Preview (Non-reasoning)
Google
8.7
439Nova 2.0 Lite (Non-reasoning)
Amazon
8.7
440Claude 3 Opus
Anthropic
8.7
441Gemini 2.0 Pro Experimental (Feb '25)
Google
8.7
442Devstral Small (May '25)
Mistral
8.7
443MiniCPM5-1B (Non-reasoning)
OpenBMB
8.7
444Devstral 2
Mistral
8.6
445Magistral Small 1.2
Mistral
8.6
446Qwen3 32B (Reasoning)
Alibaba
8.6
447DeepSeek V3 (Dec '24)
DeepSeek
8.5
448Gemini 2.5 Flash-Lite (Reasoning)
Google
8.5
449GLM-4.6V (Non-reasoning)
Z AI
8.4
450Qwen3 VL 32B Instruct
Alibaba
8.4
451Nanbeige4.1-3B
Nanbeige
8.4
452GPT-4o (Nov '24)
OpenAI
8.4
453DeepSeek R1 Distill Qwen 32B
DeepSeek
8.4
454LFM2.5-2.6B
Liquid AI
8.4
455Qwen3 235B A22B (Non-reasoning)
Alibaba
8.3
456Magistral Small 1
Mistral
8.2
457Nova 2.0 Omni (Non-reasoning)
Amazon
8.2
458Mistral Small 3.2
Mistral
8.2
459EXAONE 4.0 32B (Reasoning)
LG AI Research
8.2
460Qwen3 14B (Reasoning)
Alibaba
8.2
461Qwen3 VL 8B (Reasoning)
Alibaba
8.2
462Gemini 2.0 Flash (experimental)
Google
8.2
463DeepSeek R1 0528 Qwen3 8B
DeepSeek
8.1
464Llama 4 Scout
Meta
8.1
465Qwen2.5 Max
Alibaba
8.0
466Claude 3.5 Sonnet (Oct '24)
Anthropic
7.9
467Gemini 1.5 Pro (Sep '24)
Google
7.9
468Solar Pro 2 (Preview) (Non-reasoning)
Upstage
7.9
469DeepSeek R1 Distill Llama 70B
DeepSeek
7.9
470Qwen3 VL 30B A3B Instruct
Alibaba
7.9
471Hermes 4 - Llama-3.1 70B (Reasoning)
Nous Research
7.9
472GPT-4.1 nano
OpenAI
7.8
473Ling-flash-2.0
InclusionAI
7.8
474Gemma 4 E2B (Reasoning)
Google
7.8
475DeepSeek R1 Distill Qwen 14B
DeepSeek
7.8
476Solar Pro 3
Upstage
7.8
477Qwen3 Omni 30B A3B (Reasoning)
Alibaba
7.8
478Falcon-H1R-7B
TII UAE
7.8
479Sonar
Perplexity
7.7
480GPT-4o (Aug '24)
OpenAI
7.7
481Llama 3.3 Instruct 70B
Meta
7.7
482Step3 VL 10B
StepFun
7.7
483Qwen2.5 Instruct 72B
Alibaba
7.7
484GLM-4.5V (Reasoning)
Z AI
7.6
485Sonar Pro
Perplexity
7.6
486Qwen3 30B A3B (Reasoning)
Alibaba
7.6
487Mistral Large 2 (Nov '24)
Mistral
7.6
488QwQ 32B-Preview
Alibaba
7.6
489Devstral Small (Jul '25)
Mistral
7.6
490Gemma 4 E4B (Non-reasoning)
Google
7.5
491NVIDIA Nemotron Nano 12B v2 VL (Reasoning)
NVIDIA
7.5
492Qwen3 30B A3B 2507 Instruct
Alibaba
7.5
493Hermes 4 - Llama-3.1 405B (Reasoning)
Nous Research
7.5
494ERNIE 4.5 300B A47B
Baidu
7.5
495Devstral Small 2
Mistral
7.5
496Llama 3.1 Nemotron Ultra 253B v1 (Reasoning)
NVIDIA
7.5
497Solar Pro 2 (Reasoning)
Upstage
7.5
498Llama Nemotron Super 49B v1.5 (Non-reasoning)
NVIDIA
7.4
499Gemini 2.0 Flash-Lite (Feb '25)
Google
7.4
500Hermes 4 - Llama-3.1 405B (Non-reasoning)
Nous Research
7.4
501Granite 4.1 30B
IBM
7.4
502NVIDIA Nemotron Nano 9B V2 (Reasoning)
NVIDIA
7.4
503Qwen3 VL 8B Instruct
Alibaba
7.3
504Gemini 2.0 Flash-Lite (Preview)
Google
7.3
505Llama 3.1 Instruct 405B
Meta
7.3
506Kimi Linear 48B A3B Instruct
Kimi
7.3
507Qwen3 8B (Reasoning)
Alibaba
7.3
508Llama 3.1 Nemotron Nano 4B v1.1 (Reasoning)
NVIDIA
7.3
509Qwen3 32B (Non-reasoning)
Alibaba
7.3
510Llama 3.3 Nemotron Super 49B v1 (Non-reasoning)
NVIDIA
7.3
511K2-V2 (Low)
Institute of Foundation Models
7.3
512GPT-4o (May '24)
OpenAI
7.3
513Qwen3 4B (Reasoning)
Alibaba
7.2
514Ring-flash-2.0
InclusionAI
7.2
515Claude 3.5 Sonnet (June '24)
Anthropic
7.2
516GPT-4o (ChatGPT)
OpenAI
7.2
517LFM2.5-8B-A1B
Liquid AI
7.2
518Llama 3.1 Tulu3 405B
Allen Institute for AI
7.2
519GPT-5 nano (Minimal)
OpenAI
7.1
520Mistral Small 3.1
Mistral
7.1
521Grok 2 (Dec '24)
SpaceXAI
7.1
522Olmo 3.1 32B Think
Allen Institute for AI
7.1
523Gemini 1.5 Flash (Sep '24)
Google
7.1
524Pixtral Large
Mistral
7.1
525Command A
Cohere
7.0
526Solar Pro 2 (Non-reasoning)
Upstage
7.0
527Nova Pro
Amazon
7.0
528GPT-4 Turbo
OpenAI
7.0
529Qwen3 VL 4B (Reasoning)
Alibaba
7.0
530Qwen2.5 Instruct 32B
Alibaba
6.9
531Qwen3.5 2B (Reasoning)
Alibaba
6.9
532Llama 3.1 Nemotron Instruct 70B
NVIDIA
6.9
533Llama 3.1 Instruct 8B
Meta
6.9
534Grok Beta
SpaceXAI
6.9
535Mistral Large 2 (Jul '24)
Mistral
6.8
536NVIDIA Nemotron 3 Nano 30B A3B (Non-reasoning)
NVIDIA
6.8
537NVIDIA Nemotron Nano 9B V2 (Non-reasoning)
NVIDIA
6.8
538GLM-4.5V (Non-reasoning)
Z AI
6.7
539Qwen2.5 Coder Instruct 32B
Alibaba
6.7
540Gemini 2.5 Flash-Lite (Non-reasoning)
Google
6.7
541Hermes 4 - Llama-3.1 70B (Non-reasoning)
Nous Research
6.7
542Nova Lite
Amazon
6.7
543GPT-4
OpenAI
6.7
544Qwen3 4B 2507 Instruct
Alibaba
6.7
545GPT-4o mini
OpenAI
6.7
546Mistral Small 3
Mistral
6.7
547Qwen3 14B (Non-reasoning)
Alibaba
6.7
548Llama 3.1 Instruct 70B
Meta
6.6
549Sarvam 30B (High)
Sarvam
6.6
550Granite 4.1 8B
IBM
6.6
551DeepSeek-V2.5
DeepSeek
6.6
552DeepSeek-V2.5 (Dec '24)
DeepSeek
6.6
553Gemini 2.0 Flash Thinking Experimental (Dec '24)
Google
6.6
554Qwen3 4B (Non-reasoning)
Alibaba
6.6
555Qwen3 30B A3B (Non-reasoning)
Alibaba
6.6
556DeepSeek R1 Distill Llama 8B
DeepSeek
6.5
557Gemma 4 E2B (Non-reasoning)
Google
6.5
558Mistral Saba
Mistral
6.5
559Olmo 3.1 32B Instruct
Allen Institute for AI
6.5
560Olmo 3 32B Think
Allen Institute for AI
6.5
561Gemini 1.5 Pro (May '24)
Google
6.4
562Qwen2.5 Turbo
Alibaba
6.4
563R1 1776
Perplexity
6.4
564Llama 3.2 Instruct 90B (Vision)
Meta
6.4
565Reka Flash (Sep '24)
Reka AI
6.4
566Solar Mini
Upstage
6.4
567EXAONE 4.0 32B (Non-reasoning)
LG AI Research
6.3
568Grok-1
SpaceXAI
6.3
569Qwen2 Instruct 72B
Alibaba
6.3
570Celeris-1
Celeris
6.3
571Phi-4 Mini Instruct
Microsoft
6.3
572Qwen3.5 2B (Non-reasoning)
Alibaba
6.2
573Gemini 1.5 Flash-8B
Google
6.2
574Jamba 1.7 Large
AI21 Labs
6.1
575Qwen3.5 0.8B (Reasoning)
Alibaba
6.1
576DeepHermes 3 - Mistral 24B Preview (Non-reasoning)
Nous Research
6.1
577Qwen3 Omni 30B A3B Instruct
Alibaba
6.0
578Hermes 3 - Llama-3.1 70B
Nous Research
6.0
579OLMo 2 32B
Allen Institute for AI
6.0
580Granite 4.0 H Small
IBM
6.0
581Ministral 3 14B
Mistral
6.0
582DeepSeek-Coder-V2
DeepSeek
6.0
583Jamba 1.6 Large
AI21 Labs
6.0
584Qwen3 8B (Non-reasoning)
Alibaba
6.0
585Jamba 1.5 Large
AI21 Labs
6.0
586Nova Micro
Amazon
5.9
587Granite 4.1 3B
IBM
5.9
588Gemini 1.5 Flash (May '24)
Google
5.9
589Claude 3 Sonnet
Anthropic
5.9
590Phi-4
Microsoft
5.9
591LFM2 24B A2B
Liquid AI
5.9
592Gemini 1.0 Ultra
Google
5.8
593Phi-4 Multimodal Instruct
Microsoft
5.8
594Mistral Large (Feb '24)
Mistral
5.8
595Mistral Small (Sep '24)
Mistral
5.8
596NVIDIA Nemotron Nano 12B v2 VL (Non-reasoning)
NVIDIA
5.8
597Gemma 3n E4B Instruct Preview (May '25)
Google
5.8
598Phi-3 Mini Instruct 3.8B
Microsoft
5.8
599Qwen2.5 Coder Instruct 7B
Alibaba
5.8
600MiniCPM-V 4.6 1.3B
OpenBMB
5.7
601Llama 3.2 Instruct 3B
Meta
5.7
602Mixtral 8x22B Instruct
Mistral
5.7
603Qwen1.5 Chat 110B
Alibaba
5.7
604Qwen3 VL 4B Instruct
Alibaba
5.7
605Jamba Reasoning 3B
AI21 Labs
5.7
606Llama 2 Chat 7B
Meta
5.7
607Claude 3 Haiku
Anthropic
5.6
608Olmo 3 7B Think
Allen Institute for AI
5.6
609Claude 2.1
Anthropic
5.6
610Molmo 7B-D
Allen Institute for AI
5.6
611Reka Flash 3
Reka AI
5.6
612OLMo 2 7B
Allen Institute for AI
5.6
613GPT-3.5 Turbo
OpenAI
5.5
614Mistral Medium
Mistral
5.5
615DeepSeek-V2-Chat
DeepSeek
5.5
616Mistral Small (Feb '24)
Mistral
5.5
617Ling-mini-2.0
InclusionAI
5.5
618DeepSeek R1 Distill Qwen 1.5B
DeepSeek
5.5
619Ministral 3 8B
Mistral
5.5
620Llama 3 Instruct 70B
Meta
5.5
621Claude 2.0
Anthropic
5.5
622LFM 40B
Liquid AI
5.4
623Qwen3.5 0.8B (Non-reasoning)
Alibaba
5.4
624Qwen Chat 72B
Alibaba
5.4
625PALM-2
Google
5.4
626Llama 3.2 Instruct 11B (Vision)
Meta
5.4
627Arctic Instruct
Snowflake
5.4
628DBRX Instruct
Databricks
5.3
629Sarvam M (Reasoning, Based on Mistral Small 3.1)
Sarvam
5.3
630Llama 2 Chat 70B
Meta
5.3
631Llama 2 Chat 13B
Meta
5.3
632Command-R+ (Apr '24)
Cohere
5.3
633DeepSeek LLM 67B Chat (V1)
DeepSeek
5.3
634Gemini 1.0 Pro
Google
5.3
635DeepSeek Coder V2 Lite Instruct
DeepSeek
5.3
636Exaone 4.0 1.2B (Reasoning)
LG AI Research
5.3
637OpenChat 3.5 (1210)
OpenChat
5.3
638LFM2.5-1.2B-Instruct
Liquid AI
5.2
639Jamba 1.5 Mini
AI21 Labs
5.2
640Qwen3 1.7B (Reasoning)
Alibaba
5.2
641LFM2.5-1.2B-Thinking
Liquid AI
5.2
642LFM2 2.6B
Liquid AI
5.2
643Exaone 4.0 1.2B (Non-reasoning)
LG AI Research
5.2
644Olmo 3 7B Instruct
Allen Institute for AI
5.2
645Jamba 1.7 Mini
AI21 Labs
5.2
646Granite 4.0 H 1B
IBM
5.2
647Jamba 1.6 Mini
AI21 Labs
5.2
648Gemma 3 270M
Google
5.1
649Granite 4.0 Micro
IBM
5.1
650Mixtral 8x7B Instruct
Mistral
5.1
651Apertus 70B Instruct
Swiss AI Initiative
5.1
652DeepHermes 3 - Llama-3.1 8B Preview (Non-reasoning)
Nous Research
5.1
653Mistral 7B Instruct
Mistral
5.0
654Molmo2-8B
Allen Institute for AI
5.0
655Claude Instant
Anthropic
5.0
656Granite 4.0 1B
IBM
5.0
657Command-R (Mar '24)
Cohere
5.0
658Qwen Chat 14B
Alibaba
5.0
659Llama 65B
Meta
5.0
660Qwen3 1.7B (Non-reasoning)
Alibaba
4.9
661Gemma 3 27B Instruct
Google
4.9
662Granite 3.3 8B (Non-reasoning)
IBM
4.9
663LFM2 8B A1B
Liquid AI
4.9
664Qwen3 0.6B (Non-reasoning)
Alibaba
4.8
665LFM2 1.2B
Liquid AI
4.8
666Gemma 3 4B Instruct
Google
4.8
667LFM2.5-VL-1.6B
Liquid AI
4.8
668Qwen3 0.6B (Reasoning)
Alibaba
4.8
669Granite 4.0 350M
IBM
4.8
670Ministral 3 3B
Mistral
4.8
671Llama 3.2 Instruct 1B
Meta
4.8
672Tiny Aya Global
Cohere
4.8
673Llama 3 Instruct 8B
Meta
4.8
674Apertus 8B Instruct
Swiss AI Initiative
4.8
675NVIDIA Nemotron 3 Nano 4B
NVIDIA
4.8
676Granite 4.0 H 350M
IBM
4.8
677Gemma 3n E4B Instruct
Google
4.8
678Gemma 3n E2B Instruct
Google
4.8
679Gemma 3 1B Instruct
Google
4.8
680Gemma 3 12B Instruct
Google
3.8
681K2 Horizon 0.9B
Institute of Foundation Models
3.0

Quelle: artificialanalysis.ai

Top 10 Preis-Leistung

Ranking nach kombinierter Bewertung aus Preis, Quota und Modell-Leistungsfähigkeit (Coding + Terminal-Bench + Allgemeinwissen). Pläne mit +86-Telefonpflicht ausgeschlossen. Stand: Juni 2026.

1

Xiaomi MiMo · Pro

$50/Monat38B credits/mo
+Opus-level Modelle
+Vision-Support
+Thinking/Reasoning
+8 Modelle
2

MiniMax Token Plan · Explore

$55/Monat5.1B tokens/mo
+Opus-level Modelle
+Milliarden-Tokens/Monat
+Vision-Support
+Thinking/Reasoning
−$55/mo — premium
3

Canopy Wave · Unlimited Token Plan 200M

$59.99/Monat200M tokens/mo
+Opus-level Modelle
+Vision-Support
+Thinking/Reasoning
−$59.99/mo — premium
4

Agnes AI · Pro

$50/Monat4.3M requests/mo
+Opus-level Modelle
+Vision-Support
+Thinking/Reasoning
+8 Modelle
5

BytePlus ModelArk · Pro

$50/Monat1.4M requests/mo
+Opus-level Modelle
+120K+ Requests/Monat
+Vision-Support
+Thinking/Reasoning
+12 Modelle
6

Alibaba / Qwen · Pro

$50/Monat864K requests/mo
+Opus-level Modelle
+90K+ Requests/Monat
+Vision-Support
+Thinking/Reasoning
+10 Modelle
7

Synthetic · Subscription Pack

$30/Monat72K requests/mo
+Opus-level Modelle
+Vision-Support
+Thinking/Reasoning
+8 Modelle
8

QwenCloud Token Plan · Pro

$80/Monat180K requests/mo
+Opus-level Modelle
+180K+ Requests/Monat
+Vision-Support
+Thinking/Reasoning
+11 Modelle
−$80/mo — premium
9

Warp · Build

$20/Monat500 credits/mo
+$20/mo — günstig
+Opus-level Modelle
+Vision-Support
+Thinking/Reasoning
+22 Modelle
10

Venice AI · Pro Plus

$68/Monat500 credits/mo
+Opus-level Modelle
+Vision-Support
+Thinking/Reasoning
+81 Modelle
−$68/mo — premium

Methodik: Aktive Pläne ohne +86-Telefonpflicht werden algorithmisch nach kombinierter Punktzahl aus Preis (0.4), Quota-Volumen (0.4) und Modell-Coverage (0.2) sortiert. Quota wird grob normalisiert: 1 Credit ≈ 1 Token, 1 Request ≈ 1 Prompt. Pläne mit komplexen Multiplikatoren (z.B. Credits mit Cache-Multiplikatoren) werden tendenziell überbewertet. Preise sind reguläre Monatspreise ohne Einführungsrabatte. Stand: 14. Juni 2026.

Unterstützte Coding ToolsSupported Coding Tools

Diese AI Coding Assistenten funktionieren mit verschiedenen IDEs und Terminal-ToolsThese AI coding assistants work with various IDE and terminal tools

Claude Code
Terminal-basierter AI AssistentTerminal-based AI assistant
Cursor
AI-nativer Code-EditorAI-native code editor
Cline
VS Code ErweiterungVS Code extension
Trae
AI Coding PartnerAI coding partner
Kilo Code
IDE ErweiterungIDE extension
OpenCode
Open-source AI AgentOpen-source AI agent
Goose
AI Coding AssistentAI coding assistant
Roo Code
VS Code AI ErweiterungVS Code AI extension
Codex CLI
Codex CLICodex CLI
Continue
ContinueContinue
OpenClaw
Self-hosted AssistentSelf-hosted assistant
Qwen Code
Qwen CLI ToolQwen's CLI tool
Qoder
QoderQoder
Kilo CLI
Kilo CLIKilo CLI
Codex
OpenAIs Coding ToolOpenAI's coding tool
Codebuddy
CodebuddyCodebuddy
QwenPaw
QwenPawQwenPaw
Cherry Studio
AI Produktivitäts-StudioAI productivity studio
Chatbox
ChatboxChatbox
Lingma
LingmaLingma
Hermes Agent
Hermes AgentHermes Agent
Amazon Q IDE plugins (VS Code, JetBrains)
Amazon Q IDE plugins (VS Code, JetBrains)Amazon Q IDE plugins (VS Code, JetBrains)
Amazon Q CLI
Amazon Q CLIAmazon Q CLI
AWS Console
AWS ConsoleAWS Console
MCP servers
MCP serversMCP servers
Gemini CLI
Google Gemini CLIGoogle Gemini CLI
TRAE
TRAETRAE
VS Code
VS CodeVS Code
JetBrains IDEs
JetBrains IDEsJetBrains IDEs
Vim
VimVim
Auggie CLI
Auggie CLIAuggie CLI
GitHub
GitHubGitHub
Slack
SlackSlack
Cosmos
CosmosCosmos
CC Switch
CC SwitchCC Switch
Blackbox CLI
Blackbox CLIBlackbox CLI
Blackbox IDE
Blackbox IDEBlackbox IDE
Blackbox Web
Blackbox WebBlackbox Web
Blackbox Mobile
Blackbox MobileBlackbox Mobile
Blackbox Builder
Blackbox BuilderBlackbox Builder
Blackbox API
Blackbox APIBlackbox API
TraeCode
TraeCodeTraeCode
Dify
DifyDify
Cerebras Inference API
Cerebras Inference APICerebras Inference API
via OpenRouter
via OpenRoutervia OpenRouter
via HuggingFace
via HuggingFacevia HuggingFace
via Vercel AI Gateway
via Vercel AI Gatewayvia Vercel AI Gateway
Crush
AI Coding ToolAI coding tool
chutes CLI
chutes CLIchutes CLI
OpenAI-compatible API
OpenAI-compatible APIOpenAI-compatible API
Claude Chat (Web/iOS/Android/Desktop)
Claude Chat (Web/iOS/Android/Desktop)Claude Chat (Web/iOS/Android/Desktop)
Claude Cowork
Claude CoworkClaude Cowork
Claude Design
Claude DesignClaude Design
Claude for Microsoft 365
Claude for Microsoft 365Claude for Microsoft 365
Claude Science
Claude ScienceClaude Science
Claude for Microsoft Outlook
Claude for Microsoft OutlookClaude for Microsoft Outlook
Cline IDE
Cline IDECline IDE
Cline CLI
Cline CLICline CLI
Cline SDK
Cline SDKCline SDK
OpenAI-compatible API (other agents)
OpenAI-compatible API (other agents)OpenAI-compatible API (other agents)
CodeAnt CLI
CodeAnt CLICodeAnt CLI
CodeAnt IDE (VS Code, JetBrains, Cursor)
CodeAnt IDE (VS Code, JetBrains, Cursor)CodeAnt IDE (VS Code, JetBrains, Cursor)
GitHub, GitLab, Bitbucket, Azure DevOps
GitHub, GitLab, Bitbucket, Azure DevOpsGitHub, GitLab, Bitbucket, Azure DevOps
Jira
JiraJira
Azure Boards
Azure BoardsAzure Boards
VS Code extension
VS Code extensionVS Code extension
JetBrains extension
JetBrains extensionJetBrains extension
Visual Studio extension
Visual Studio extensionVisual Studio extension
HBuilderX extension
HBuilderX extensionHBuilderX extension
CodeGeeX Ask (HuggingFace Space)
CodeGeeX Ask (HuggingFace Space)CodeGeeX Ask (HuggingFace Space)
Cosine CLI
Cosine CLICosine CLI
Cosine Desktop
Cosine DesktopCosine Desktop
Cosine Cloud
Cosine CloudCosine Cloud
GitLab
GitLabGitLab
Linear
LinearLinear
Cursor IDE
Cursor IDECursor IDE
Cursor CLI
Cursor CLICursor CLI
Cursor Cloud Agents
Cursor Cloud AgentsCursor Cloud Agents
Cursor Tab
Cursor TabCursor Tab
Cursor Marketplace
Cursor MarketplaceCursor Marketplace
Edlide IDE (VS Code-based)
Edlide IDE (VS Code-based)Edlide IDE (VS Code-based)
Edlide CLI
Edlide CLIEdlide CLI
Fireworks API
Fireworks APIFireworks API
OpenAI-compatible endpoint
OpenAI-compatible endpointOpenAI-compatible endpoint
Pi
PiPi
LangChain Deep Agents
LangChain Deep AgentsLangChain Deep Agents
Firmware Sidekick
Firmware SidekickFirmware Sidekick
Frogbot API
Frogbot APIFrogbot API
Browser Agent MCP
Browser Agent MCPBrowser Agent MCP
Visual Studio
Visual StudioVisual Studio
Neovim
NeovimNeovim
Eclipse
EclipseEclipse
Xcode
XcodeXcode
Zed
ZedZed
GitHub CLI
GitHub CLIGitHub CLI
GitHub Mobile
GitHub MobileGitHub Mobile
Raycast
RaycastRaycast
SQL Server Management Studio
SQL Server Management StudioSQL Server Management Studio
GitHub Copilot app (Desktop)
GitHub Copilot app (Desktop)GitHub Copilot app (Desktop)
GitLab Web IDE
GitLab Web IDEGitLab Web IDE
GitLab Duo CLI
GitLab Duo CLIGitLab Duo CLI
Duo Chat
Duo ChatDuo Chat
Code Suggestions
Code SuggestionsCode Suggestions
Duo Agents
Duo AgentsDuo Agents
Duo Flows
Duo FlowsDuo Flows
Antigravity IDE
Antigravity IDEAntigravity IDE
Antigravity CLI
Antigravity CLIAntigravity CLI
Antigravity SDK
Antigravity SDKAntigravity SDK
Cloud Workstations
Cloud WorkstationsCloud Workstations
Android Studio
Android StudioAndroid Studio
Firebase
FirebaseFirebase
Cloud Run
Cloud RunCloud Run
BigQuery
BigQueryBigQuery
HuggingChat
HuggingChatHuggingChat
Hugging Face Inference API
Hugging Face Inference APIHugging Face Inference API
Inference Playground
Inference PlaygroundInference Playground
NeMo Data Designer
NeMo Data DesignerNeMo Data Designer
MacWhisper
MacWhisperMacWhisper
Vision Agents
Vision AgentsVision Agents
VS Code with GitHub Copilot
VS Code with GitHub CopilotVS Code with GitHub Copilot
CodeX
CodeXCodeX
iFlytek Spark API
iFlytek Spark APIiFlytek Spark API
Infini-AI Gen Studio
Infini-AI Gen StudioInfini-AI Gen Studio
Infini-AI API
Infini-AI APIInfini-AI API
JD Cloud API
JD Cloud APIJD Cloud API
JDAIP SDK
JDAIP SDKJDAIP SDK
Junie (coding agent)
Junie (coding agent)Junie (coding agent)
Claude Agent
Claude AgentClaude Agent
Codex agent
Codex agentCodex agent
JetBrains IDEs (IntelliJ, PyCharm, WebStorm, GoLand, etc.)
JetBrains IDEs (IntelliJ, PyCharm, WebStorm, GoLand, etc.)JetBrains IDEs (IntelliJ, PyCharm, WebStorm, GoLand, etc.)
ReSharper
ReSharperReSharper
Kilo Code (VS Code, JetBrains, CLI)
Kilo Code (VS Code, JetBrains, CLI)Kilo Code (VS Code, JetBrains, CLI)
Kimi Code CLI
Kimi Terminal AgentKimi terminal agent
Terminal
TerminalTerminal
IDE
IDEIDE
via Alibaba Coding Plan
via Alibaba Coding Planvia Alibaba Coding Plan
Kiro IDE
Kiro IDEKiro IDE
Kiro CLI
Kiro CLIKiro CLI
Kiro Web
Kiro WebKiro Web
Kiro Crew
Kiro CrewKiro Crew
ACP-compatible IDEs
ACP-compatible IDEsACP-compatible IDEs
Kiro Powers
Kiro PowersKiro Powers
Lovable Browser IDE
Lovable Browser IDELovable Browser IDE
Supabase
SupabaseSupabase
MiniMax Code
MiniMax CodeMiniMax Code
via API
via APIvia API
Mistral Vibe CLI
Mistral Vibe CLIMistral Vibe CLI
Le Chat
Le ChatLe Chat
Mistral Studio
Mistral StudioMistral Studio
via OpenAI-compatible API
via OpenAI-compatible APIvia OpenAI-compatible API
Ollama CLI
Lokale LLM PlatformLocal LLM platform
Desktop App
Desktop AppDesktop App
Codex IDE Extension
Codex IDE ExtensionCodex IDE Extension
Codex Web
Codex WebCodex Web
Codex iOS
Codex iOSCodex iOS
OpenCode (native)
OpenCode (native)OpenCode (native)
OpenRouter API
OpenRouter APIOpenRouter API
Multi-provider aggregation
Multi-provider aggregationMulti-provider aggregation
Model switching
Model switchingModel switching
Replit IDE (browser)
Replit IDE (browser)Replit IDE (browser)
Replit Agent (autonomous)
Replit Agent (autonomous)Replit Agent (autonomous)
Replit Design Mode
Replit Design ModeReplit Design Mode
Replit Build Mode
Replit Build ModeReplit Build Mode
Replit CLI
Replit CLIReplit CLI
Replit Mobile
Replit MobileReplit Mobile
PostgreSQL
PostgreSQLPostgreSQL
Fugu API
Fugu APIFugu API
Amp CLI
Amp CLIAmp CLI
Subagents
SubagentsSubagents
Oracle (architecture review)
Oracle (architecture review)Oracle (architecture review)
StepFun API
StepFun APIStepFun API
Step Platform
Step PlatformStep Platform
Step Studio
Step StudioStep Studio
Hermes-Agent
Hermes-AgentHermes-Agent
Open Code
Open CodeOpen Code
Synthetic UI
Synthetic UISynthetic UI
Synthetic API
Synthetic APISynthetic API
any agent framework
any agent frameworkany agent framework
Tabnine IDE Plugin (VS Code, JetBrains, Eclipse, VS 2022)
Tabnine IDE Plugin (VS Code, JetBrains, Eclipse, VS 2022)Tabnine IDE Plugin (VS Code, JetBrains, Eclipse, VS 2022)
Tabnine CLI
Tabnine CLITabnine CLI
Tabnine Chat
Tabnine ChatTabnine Chat
Context Engine
Context EngineContext Engine
AutoClaw
AutoClawAutoClaw
WorkBuddy
WorkBuddyWorkBuddy
CoPaw
CoPawCoPaw
QClaw
QClawQClaw
Lighthouse OpenClaw
Lighthouse OpenClawLighthouse OpenClaw
DeepSeek Harness
DeepSeek HarnessDeepSeek Harness
CodeBuddy Code
CodeBuddy CodeCodeBuddy Code
Tencent Cloud LLM API
Tencent Cloud LLM APITencent Cloud LLM API
Hunyuan SDK
Hunyuan SDKHunyuan SDK
omp
ompomp
Grok CLI
xAI Grok CLIxAI Grok CLI
Copilot
CopilotCopilot
UniAI MaaS Platform
UniAI MaaS PlatformUniAI MaaS Platform
API
APIAPI
Venice AI Web
Venice AI WebVenice AI Web
Venice API
Venice APIVenice API
Warp Terminal (AGPL-3.0 open source)
Warp Terminal (AGPL-3.0 open source)Warp Terminal (AGPL-3.0 open source)
Warp Agent
Warp AgentWarp Agent
Oz Agent Platform (cloud orchestration)
Oz Agent Platform (cloud orchestration)Oz Agent Platform (cloud orchestration)
Warp Factories (Early Access)
Warp Factories (Early Access)Warp Factories (Early Access)
Claude Code (in Warp)
Claude Code (in Warp)Claude Code (in Warp)
Codex (in Warp)
Codex (in Warp)Codex (in Warp)
OpenCode (in Warp)
OpenCode (in Warp)OpenCode (in Warp)
Gemini CLI (in Warp)
Gemini CLI (in Warp)Gemini CLI (in Warp)
Windsurf IDE (now Devin Desktop)
Windsurf IDE (now Devin Desktop)Windsurf IDE (now Devin Desktop)
Windsurf Cascade
Windsurf CascadeWindsurf Cascade
Windsurf CLI
Windsurf CLIWindsurf CLI
JetBrains plugin
JetBrains pluginJetBrains plugin
Supercomplete
SupercompleteSupercomplete
Fast Context
Fast ContextFast Context
Agent Client Protocol (ACP)
Agent Client Protocol (ACP)Agent Client Protocol (ACP)
CodeBuddy
CodeBuddyCodeBuddy
ZCode
ZCodeZCode
Claude for IDE
Claude for IDEClaude for IDE
SillyTavern
SillyTavernSillyTavern
Zencoder CLI
Zencoder CLIZencoder CLI
Sentry
SentrySentry
Datadog
DatadogDatadog