Skip to content

ExpertPal Tools · LLM Picker

Wähle das Modell, das die Aufgabe wirklich braucht.

Verbrenn keine Credits für ein Frontier-Modell, wenn die Aufgabe es nicht braucht.

 

Woran arbeitest du?
Priorität

Empfehlung: Claude Fable 5.1

Best value

Anthropic

Claude Fable 5.1

Am stärksten für anspruchsvolles Coding

Unsere Wahl, wenn das Ergebnis am meisten zählt.

Günstigere Modelle sind für anspruchsvolles Coding nicht stark genug.

Claude Opus 5.5 könnte für 58 % weniger genauso stark sein. Benchmarks stehen noch aus.

Top-Auswahl für anspruchsvolles Coding

Beispielkosten

  • Claude Opus 5.5Geschätzt · Benchmarks ausstehend4,00 $ / 20,00 $1,08 $−58 %
Warum dieses Modell?

Es gibt ein günstigeres Modell, aber wir halten es für diese Art von Arbeit nicht für stark genug.

Die Preise sind aktuelle Standard-API-Listenpreise des Anbieters.

02 / Vergleich

Alle Modelle, denen wir vertrauen, für anspruchsvolles Coding.

Basierend auf öffentlichen Benchmarks, von uns gewichtet – kein eigener Benchmark.

  • Claude Fable 5.1

    Anthropic

    Sehr starkBest value
    Beispielkosten
    2,60 $
    Input
    10,00 $
    Cached
    0,25 $
    Output
    50,00 $
    Kontext
    1 Mio.
  • GPT-6 Astra

    OpenAI

    Sehr stark
    Beispielkosten
    2,90 $
    Input
    10,00 $
    Cached
    1,00 $
    Output
    50,00 $
    Kontext
    1,1 Mio.
  • GPT-6 Luna

    OpenAI

    Gut genugGeschätzt · Benchmarks ausstehend
    Beispielkosten
    0,029 $
    Input
    0,10 $
    Cached
    0,01 $
    Output
    0,50 $
    Kontext
    1,1 Mio.
  • Gemini 3.8 Flash

    Google

    Gut genugGünstigste Wahl
    Beispielkosten
    0,218 $
    Input
    0,75 $
    Cached
    0,075 $
    Output
    3,75 $
    Kontext
    1 Mio.
  • Claude Sonnet 5

    Anthropic

    Gut genug
    Beispielkosten
    0,58 $
    Input
    2,00 $
    Cached
    0,20 $
    Output
    10,00 $
    Kontext
    1 Mio.
  • GPT-6 Sol

    OpenAI

    StarkGeschätzt · Benchmarks ausstehend
    Beispielkosten
    0,58 $
    Input
    2,00 $
    Cached
    0,20 $
    Output
    10,00 $
    Kontext
    1,1 Mio.
  • Claude Opus 5.5

    Anthropic

    Sehr starkGeschätzt · Benchmarks ausstehend
    Beispielkosten
    1,08 $
    Input
    4,00 $
    Cached
    0,20 $
    Output
    20,00 $
    Kontext
    1 Mio.
  • Claude Opus 4.8

    Anthropic

    Gut genug
    Beispielkosten
    1,45 $
    Input
    5,00 $
    Cached
    0,50 $
    Output
    25,00 $
    Kontext
    1 Mio.
  • Gemini 3.1 Flash Lite

    Google

    Noch zu wenig Daten
    Beispielkosten
    0,08 $
    Input
    0,25 $
    Cached
    0,025 $
    Output
    1,50 $
    Kontext
    1 Mio.
  • Gemini 3.5 Flash Lite

    Google

    Nicht empfohlen
    Beispielkosten
    0,117 $
    Input
    0,30 $
    Cached
    0,03 $
    Output
    2,50 $
    Kontext
    1 Mio.
  • Claude Haiku 4.5

    Anthropic

    Nicht empfohlen
    Beispielkosten
    0,29 $
    Input
    1,00 $
    Cached
    0,10 $
    Output
    5,00 $
    Kontext
    200.000
  • Claude Sonnet 4.6

    Anthropic

    Nicht empfohlen
    Beispielkosten
    0,87 $
    Input
    3,00 $
    Cached
    0,30 $
    Output
    15,00 $
    Kontext
    1 Mio.
  • Claude Opus 4.6

    Anthropic

    Noch zu wenig Daten
    Beispielkosten
    1,45 $
    Input
    5,00 $
    Cached
    0,50 $
    Output
    25,00 $
    Kontext
    1 Mio.

Token-Preise in USD pro 1 Mio. Tokens.

03 / Hintergrund

Warum es das gibt

Ständig kommen neue Modelle dazu. Preise ändern sich. Caching-Regeln ändern sich.

Das günstigste Modell ist nicht wirklich günstig, wenn du fünf Versuche brauchst, bis die Aufgabe erledigt ist. Und das stärkste Modell ist nicht automatisch den Aufpreis wert.

Wir halten die Auswahl bewusst klein, verfolgen die aktuellen Preise und helfen dir, das Modell zu wählen, das für die Aufgabe sinnvoll ist.

04 / Methode

Wie wir entscheiden

Wir kombinieren aktuelle API-Preise mit unserer Einschätzung, welche Modelle für welche Aufgaben stark genug sind. Diese Einschätzung berechnen wir aus öffentlichen Benchmark-Daten, gewichtet danach, worauf es bei der jeweiligen Aufgabe ankommt. Für den Kostenvergleich verwenden wir bei allen Modellen dieselbe Beispiel-Workload. Diese Einschätzungen sind praktische Erfahrungswerte, keine wissenschaftlichen Benchmarks. Kein KI-Modell entscheidet hier, welches Modell empfohlen wird.

Beispiel-Workloads für den Kostenvergleich
AufgabeInput-TokensCached-Input-TokensOutput-Tokens
Anspruchsvolles Coding100.000400.00030.000
Routine-Coding40.000100.00010.000
Komplexes Denken40.00010.00020.000
Recherche100.00050.00020.000
Schreiben & Alltag20.0005.0008.000
Einfache Aufgaben / große Mengen100.000010.000

Source: Artificial Analysis (artificialanalysis.ai) via OpenRouter (openrouter.ai/rankings), Stand 23. Sept. 2026. Lizenziert unter CC BY 4.0.

Source: OpenRouter evals (openrouter.ai) via OpenRouter (openrouter.ai/rankings), Stand 24. Sept. 2026. Lizenziert unter CC BY 4.0.