endueendue

Das richtige Modell für Ihren Agenten finden

Wählen Sie nach der Arbeit, die erledigt werden soll, nach dem nötigen Tempo und nach den Kosten. Jedes Modell hier läuft schon heute in endue.

Modelle
73
Anbieter
15

Preise und Spezifikationen geprüft am 2026-10-05

73 Modelle

Modelle filtern

Anbieter
Liest
Fähigkeiten
Geeignet für
  • xAI

    Grok 4.6

    Grok 4

    xAI’s top Grok for coding, STEM and knowledge work.

    TextText + Bilder + Dateien → Text
    • Programmieren
    • Logisches Denken
    • Lange Dokumente
    Preise
    $2 / $6 pro 1 Mio. Tokens, Eingabe / Ausgabe
    Kontextfenster
    500K Kontext
    Sofort in endue nutzbarIm Agenten verwenden
  • xAI

    Grok 4.3

    Grok 4

    Reasoning model that follows instructions closely, with a 1M context. endue’s default.

    TextText + Bilder + Dateien → Text
    • Agentenaufgaben
    • Logisches Denken
    • Lange Dokumente
    Preise
    $1.25 / $2.5 pro 1 Mio. Tokens, Eingabe / Ausgabe
    Kontextfenster
    1M Kontext
    Sofort in endue nutzbarIm Agenten verwenden
  • xAI

    Grok 4.20

    Grok 4

    Fast tool calling with a 2M context for very long inputs.

    TextText + Bilder + Dateien → Text
    • Agentenaufgaben
    • Lange Dokumente
    • Schnelle Antworten
    Preise
    $1.25 / $2.5 pro 1 Mio. Tokens, Eingabe / Ausgabe
    Kontextfenster
    2M Kontext
    Sofort in endue nutzbarIm Agenten verwenden
  • xAI

    Grok 4.5

    Grok 4

    Balanced Grok for coding and knowledge work, 500K context.

    TextText + Bilder + Dateien → Text
    • Programmieren
    • Logisches Denken
    Preise
    $2 / $6 pro 1 Mio. Tokens, Eingabe / Ausgabe
    Kontextfenster
    500K Kontext
    Sofort in endue nutzbarIm Agenten verwenden
  • xAI

    Grok Build 0.1

    Grok Build

    Fast coding model tuned for interactive software engineering.

    TextText + Bilder + Dateien → Text
    • Programmieren
    • Schnelle Antworten
    • Geringe Kosten
    Preise
    $1 / $2 pro 1 Mio. Tokens, Eingabe / Ausgabe
    Kontextfenster
    256K Kontext
    Sofort in endue nutzbarIm Agenten verwenden
  • OpenAI

    GPT-6 Astra

    GPT-6

    OpenAI’s flagship for long, demanding work: analysis, research, large codebases.

    TextDateien + Bilder + Text → Text
    • Logisches Denken
    • Programmieren
    • Lange Dokumente
    Preise
    $10 / $50 pro 1 Mio. Tokens, Eingabe / Ausgabe
    Kontextfenster
    1.1M Kontext
    Sofort in endue nutzbarIm Agenten verwenden
  • OpenAI

    GPT-6 Astra Pro

    GPT-6

    GPT-6 Astra with deeper reasoning per answer. Same price, slower replies.

    TextDateien + Bilder + Text → Text
    • Logisches Denken
    • Webrecherche
    Preise
    $10 / $50 pro 1 Mio. Tokens, Eingabe / Ausgabe
    Kontextfenster
    1.1M Kontext
    Sofort in endue nutzbarIm Agenten verwenden
  • OpenAI

    GPT-5.6 Sol

    GPT-5.6

    Top GPT-5.6 tier, strong at multi-step and command-line coding.

    TextDateien + Bilder + Text → Text
    • Programmieren
    • Agentenaufgaben
    • Logisches Denken
    Preise
    $2 / $10 pro 1 Mio. Tokens, Eingabe / Ausgabe
    Kontextfenster
    1.1M Kontext
    Sofort in endue nutzbarIm Agenten verwenden
  • OpenAI

    GPT-5.6 Terra

    GPT-5.6

    Middle GPT-5.6 tier for everyday coding and agent tasks.

    TextDateien + Bilder + Text → Text
    • Programmieren
    • Agentenaufgaben
    Preise
    $2 / $12 pro 1 Mio. Tokens, Eingabe / Ausgabe
    Kontextfenster
    1.1M Kontext
    Sofort in endue nutzbarIm Agenten verwenden
  • OpenAI

    GPT-5.6 Luna

    GPT-5.6

    Cheap, fast GPT-5.6 tier for chat, classification and high volume.

    TextDateien + Bilder + Text → Text
    • Schnelle Antworten
    • Geringe Kosten
    • Lange Dokumente
    Preise
    $0.2 / $1.2 pro 1 Mio. Tokens, Eingabe / Ausgabe
    Kontextfenster
    1.1M Kontext
    Sofort in endue nutzbarIm Agenten verwenden
  • OpenAI

    GPT-5.5

    GPT-5

    Reliable reasoning for professional workloads, 1M context.

    TextDateien + Bilder + Text → Text
    • Logisches Denken
    • Lange Dokumente
    Preise
    $5 / $30 pro 1 Mio. Tokens, Eingabe / Ausgabe
    Kontextfenster
    1.1M Kontext
    Sofort in endue nutzbarIm Agenten verwenden
  • OpenAI

    GPT-5.4

    GPT-5

    Codex and GPT merged into one model, with a 1M context.

    TextText + Bilder + Dateien → Text
    • Programmieren
    • Logisches Denken
    • Lange Dokumente
    Preise
    $2.5 / $15 pro 1 Mio. Tokens, Eingabe / Ausgabe
    Kontextfenster
    1.1M Kontext
    Sofort in endue nutzbarIm Agenten verwenden
  • OpenAI

    GPT-5.4 Mini

    GPT-5

    Smaller GPT-5.4 for high-throughput reasoning and coding.

    TextDateien + Bilder + Text → Text
    • Schnelle Antworten
    • Programmieren
    Preise
    $0.75 / $4.5 pro 1 Mio. Tokens, Eingabe / Ausgabe
    Kontextfenster
    400K Kontext
    Sofort in endue nutzbarIm Agenten verwenden
  • OpenAI

    GPT-5.4 Nano

    GPT-5

    Lightest GPT-5.4 for latency-sensitive, high-volume tasks.

    TextDateien + Bilder + Text → Text
    • Schnelle Antworten
    • Geringe Kosten
    Preise
    $0.2 / $1.25 pro 1 Mio. Tokens, Eingabe / Ausgabe
    Kontextfenster
    400K Kontext
    Sofort in endue nutzbarIm Agenten verwenden
  • OpenAI

    GPT-5.3 Codex

    GPT-5 Codex

    OpenAI’s agentic coding model for long software tasks.

    TextText + Bilder + Dateien → Text
    • Programmieren
    • Agentenaufgaben
    Preise
    $1.75 / $14 pro 1 Mio. Tokens, Eingabe / Ausgabe
    Kontextfenster
    400K Kontext
    Sofort in endue nutzbarIm Agenten verwenden
  • OpenAI

    GPT-5

    GPT-5

    Step-by-step reasoning with careful instruction following.

    TextText + Bilder + Dateien → Text
    • Logisches Denken
    • Programmieren
    Preise
    $1.25 / $10 pro 1 Mio. Tokens, Eingabe / Ausgabe
    Kontextfenster
    400K Kontext
    Sofort in endue nutzbarIm Agenten verwenden
  • OpenAI

    GPT-OSS 120B

    GPT-OSS

    Open-weight MoE with reasoning at a very low price. Text only.

    TextText → Text
    • Offene Gewichte
    • Geringe Kosten
    • Logisches Denken
    Preise
    $0.037 / $0.17 pro 1 Mio. Tokens, Eingabe / Ausgabe
    Kontextfenster
    131K Kontext
    Sofort in endue nutzbarIm Agenten verwenden
  • OpenAI

    GPT-OSS 20B

    GPT-OSS

    Small Apache-2.0 open-weight model for cheap, simple tasks.

    TextText → Text
    • Offene Gewichte
    • Geringe Kosten
    • Schnelle Antworten
    Preise
    $0.018 / $0.09 pro 1 Mio. Tokens, Eingabe / Ausgabe
    Kontextfenster
    131K Kontext
    Sofort in endue nutzbarIm Agenten verwenden
  • OpenAI

    GPT-4o mini

    GPT-4o

    Small non-reasoning model for quick, inexpensive replies.

    TextText + Bilder + Dateien → Text
    • Schnelle Antworten
    • Geringe Kosten
    Preise
    $0.15 / $0.6 pro 1 Mio. Tokens, Eingabe / Ausgabe
    Kontextfenster
    128K Kontext
    Sofort in endue nutzbarIm Agenten verwenden
  • Anthropic

    Claude Opus 5

    Claude Opus

    Anthropic’s flagship for code review, bug finding and long agent runs.

    TextText + Bilder + Dateien → Text
    • Programmieren
    • Agentenaufgaben
    • Logisches Denken
    Preise
    $5 / $25 pro 1 Mio. Tokens, Eingabe / Ausgabe
    Kontextfenster
    1M Kontext
    Sofort in endue nutzbarIm Agenten verwenden
  • Anthropic

    Claude Fable 5.1

    Claude Fable

    Fable 5 improved for long refactors, front-end work and knowledge tasks.

    TextText + Bilder + Dateien → Text
    • Programmieren
    • Agentenaufgaben
    • Lange Dokumente
    Preise
    $10 / $50 pro 1 Mio. Tokens, Eingabe / Ausgabe
    Kontextfenster
    1M Kontext
    Sofort in endue nutzbarIm Agenten verwenden
  • Anthropic

    Claude Fable 5

    Claude Fable

    Built for autonomous knowledge work and coding.

    TextText + Bilder + Dateien → Text
    • Agentenaufgaben
    • Programmieren
    Preise
    $10 / $50 pro 1 Mio. Tokens, Eingabe / Ausgabe
    Kontextfenster
    1M Kontext
    Sofort in endue nutzbarIm Agenten verwenden
  • Anthropic

    Claude Opus 4.8

    Claude Opus

    Latest Opus 4 release, 1M context.

    TextText + Bilder + Dateien → Text
    • Programmieren
    • Logisches Denken
    • Lange Dokumente
    Preise
    $5 / $25 pro 1 Mio. Tokens, Eingabe / Ausgabe
    Kontextfenster
    1M Kontext
    Sofort in endue nutzbarIm Agenten verwenden
  • Anthropic

    Claude Sonnet 5

    Claude Sonnet

    Strong coding and agent work at a lower price than Opus.

    TextText + Bilder + Dateien → Text
    • Programmieren
    • Agentenaufgaben
    Preise
    $2 / $10 pro 1 Mio. Tokens, Eingabe / Ausgabe
    Kontextfenster
    1M Kontext
    Sofort in endue nutzbarIm Agenten verwenden
  • Anthropic

    Claude Sonnet 4.5

    Claude Sonnet

    Sonnet tuned for real-world agents and coding workflows.

    TextText + Bilder + Dateien → Text
    • Programmieren
    • Agentenaufgaben
    Preise
    $3 / $15 pro 1 Mio. Tokens, Eingabe / Ausgabe
    Kontextfenster
    1M Kontext
    Sofort in endue nutzbarIm Agenten verwenden
  • Anthropic

    Claude Haiku 4.5

    Claude Haiku

    Fastest Claude, near Sonnet 4 quality at lower cost.

    TextText + Bilder + Dateien → Text
    • Schnelle Antworten
    • Geringe Kosten
    Preise
    $1 / $5 pro 1 Mio. Tokens, Eingabe / Ausgabe
    Kontextfenster
    200K Kontext
    Sofort in endue nutzbarIm Agenten verwenden
  • Anthropic

    Claude Opus 4.7

    Claude Opus

    Opus for long-running, asynchronous agents.

    TextText + Bilder + Dateien → Text
    • Agentenaufgaben
    • Programmieren
    Preise
    $5 / $25 pro 1 Mio. Tokens, Eingabe / Ausgabe
    Kontextfenster
    1M Kontext
    Sofort in endue nutzbarIm Agenten verwenden
  • Anthropic

    Claude Opus 4.6

    Claude Opus

    Opus for agents that run whole workflows, not single prompts.

    TextText + Bilder + Dateien → Text
    • Agentenaufgaben
    • Programmieren
    Preise
    $5 / $25 pro 1 Mio. Tokens, Eingabe / Ausgabe
    Kontextfenster
    1M Kontext
    Sofort in endue nutzbarIm Agenten verwenden
  • Anthropic

    Claude Sonnet 4.6

    Claude Sonnet

    Iterative development and navigating large codebases.

    TextText + Bilder + Dateien → Text
    • Programmieren
    • Agentenaufgaben
    Preise
    $3 / $15 pro 1 Mio. Tokens, Eingabe / Ausgabe
    Kontextfenster
    1M Kontext
    Sofort in endue nutzbarIm Agenten verwenden
  • Anthropic

    Claude Opus 4.5

    Claude Opus

    Opus for complex software engineering and computer use, 200K context.

    TextDateien + Bilder + Text → Text
    • Programmieren
    • Agentenaufgaben
    Preise
    $5 / $25 pro 1 Mio. Tokens, Eingabe / Ausgabe
    Kontextfenster
    200K Kontext
    Sofort in endue nutzbarIm Agenten verwenden
  • Anthropic

    Claude Opus 4.1

    Claude Opus

    Earlier Opus. The most expensive Claude here; newer Opus models cost less.

    TextBilder + Text + Dateien → Text
    • Programmieren
    • Logisches Denken
    Preise
    $15 / $75 pro 1 Mio. Tokens, Eingabe / Ausgabe
    Kontextfenster
    200K Kontext
    Sofort in endue nutzbarIm Agenten verwenden
  • Google

    Gemini 3.8 Flash

    Gemini Flash

    Latest Gemini Flash. Reads text, images, audio and video; 1M context.

    MultimodalText + Bilder + Video + Dateien + Audio → Text
    • Audio & Video
    • Agentenaufgaben
    • Lange Dokumente
    Preise
    $0.75 / $3.75 pro 1 Mio. Tokens, Eingabe / Ausgabe
    Kontextfenster
    1M Kontext
    Sofort in endue nutzbarIm Agenten verwenden
  • Google

    Gemini 3.5 Flash

    Gemini Flash

    Near-Pro coding and reasoning at Flash cost, with parallel tool use.

    MultimodalText + Bilder + Video + Dateien + Audio → Text
    • Programmieren
    • Audio & Video
    • Agentenaufgaben
    Preise
    $1.5 / $9 pro 1 Mio. Tokens, Eingabe / Ausgabe
    Kontextfenster
    1M Kontext
    Sofort in endue nutzbarIm Agenten verwenden
  • Google

    Gemini 3.6 Flash

    Gemini Flash

    Flash model for coding and web/app development with fewer stray edits.

    MultimodalText + Bilder + Video + Dateien + Audio → Text
    • Programmieren
    • Audio & Video
    Preise
    $0.75 / $3.75 pro 1 Mio. Tokens, Eingabe / Ausgabe
    Kontextfenster
    1M Kontext
    Sofort in endue nutzbarIm Agenten verwenden
  • Google

    Gemini 3.5 Flash Lite

    Gemini Flash-Lite

    Cheap Gemini for sub-agents that run focused tasks.

    MultimodalText + Bilder + Video + Dateien + Audio → Text
    • Geringe Kosten
    • Audio & Video
    • Schnelle Antworten
    Preise
    $0.3 / $2.5 pro 1 Mio. Tokens, Eingabe / Ausgabe
    Kontextfenster
    1M Kontext
    Sofort in endue nutzbarIm Agenten verwenden
  • Google

    Gemini 2.5 Pro

    Gemini Pro

    Gemini with step-by-step thinking for math, science and code.

    MultimodalText + Bilder + Dateien + Audio + Video → Text
    • Logisches Denken
    • Audio & Video
    • Lange Dokumente
    Preise
    $1.25 / $10 pro 1 Mio. Tokens, Eingabe / Ausgabe
    Kontextfenster
    1M Kontext
    Sofort in endue nutzbarIm Agenten verwenden
  • Google

    Gemini 3.1 Flash Lite

    Gemini Flash-Lite

    Low-latency Gemini for high volume. Reads audio, video and PDF.

    MultimodalText + Bilder + Video + Dateien + Audio → Text
    • Geringe Kosten
    • Schnelle Antworten
    • Audio & Video
    Preise
    $0.25 / $1.5 pro 1 Mio. Tokens, Eingabe / Ausgabe
    Kontextfenster
    1M Kontext
    Sofort in endue nutzbarIm Agenten verwenden
  • Google

    Gemini 2.5 Flash Lite

    Gemini Flash-Lite

    Among the cheapest multimodal models here, 1M context.

    MultimodalText + Bilder + Dateien + Audio + Video → Text
    • Geringe Kosten
    • Schnelle Antworten
    • Audio & Video
    Preise
    $0.1 / $0.4 pro 1 Mio. Tokens, Eingabe / Ausgabe
    Kontextfenster
    1M Kontext
    Sofort in endue nutzbarIm Agenten verwenden
  • Google

    Gemma 4 31B

    Gemma 4

    Open-weight dense model with image and video input and function calling.

    MultimodalBilder + Text + Video → Text
    • Offene Gewichte
    • Geringe Kosten
    • Bildverständnis
    Preise
    $0.09 / $0.34 pro 1 Mio. Tokens, Eingabe / Ausgabe
    Kontextfenster
    262K Kontext
    Sofort in endue nutzbarIm Agenten verwenden
  • Google

    Gemma 4 26B

    Gemma 4

    Open-weight MoE close to Gemma 4 31B quality at lower compute.

    MultimodalBilder + Text + Video → Text
    • Offene Gewichte
    • Geringe Kosten
    • Schnelle Antworten
    Preise
    $0.077 / $0.26 pro 1 Mio. Tokens, Eingabe / Ausgabe
    Kontextfenster
    262K Kontext
    Sofort in endue nutzbarIm Agenten verwenden
  • Moonshot AI

    Kimi K3

    Kimi

    Large open-weight multimodal model for coding and long agent runs.

    MultimodalText + Bilder + Video → Text
    • Programmieren
    • Agentenaufgaben
    • Offene Gewichte
    Preise
    $1.19 / $14 pro 1 Mio. Tokens, Eingabe / Ausgabe
    Kontextfenster
    1M Kontext
    Sofort in endue nutzbarIm Agenten verwenden
  • Moonshot AI

    Kimi K2.7 Code

    Kimi

    Coding-focused Kimi for end-to-end programming over long contexts.

    TextText + Bilder → Text
    • Programmieren
    • Agentenaufgaben
    Preise
    $0.67 / $3.35 pro 1 Mio. Tokens, Eingabe / Ausgabe
    Kontextfenster
    262K Kontext
    Sofort in endue nutzbarIm Agenten verwenden
  • Moonshot AI

    Kimi K2.6

    Kimi

    Long coding tasks, UI generation from code and multi-agent setups.

    TextText + Bilder → Text
    • Programmieren
    • Agentenaufgaben
    • Bildverständnis
    Preise
    $0.95 / $4 pro 1 Mio. Tokens, Eingabe / Ausgabe
    Kontextfenster
    262K Kontext
    Sofort in endue nutzbarIm Agenten verwenden
  • DeepSeek

    DeepSeek V4.1 Flash

    DeepSeek V4

    Low-cost DeepSeek with image input and a 1M context.

    TextText + Bilder → Text
    • Geringe Kosten
    • Lange Dokumente
    • Bildverständnis
    Preise
    $0.3 / $1.2 pro 1 Mio. Tokens, Eingabe / Ausgabe
    Kontextfenster
    1M Kontext
    Sofort in endue nutzbarIm Agenten verwenden
  • DeepSeek

    DeepSeek V4 Pro

    DeepSeek V4

    Large MoE for reasoning and coding, 1M context. Text only.

    TextText → Text
    • Logisches Denken
    • Programmieren
    • Lange Dokumente
    Preise
    $0.21 / $0.42 pro 1 Mio. Tokens, Eingabe / Ausgabe
    Kontextfenster
    1M Kontext
    Sofort in endue nutzbarIm Agenten verwenden
  • DeepSeek

    DeepSeek V4 Flash

    DeepSeek V4

    Very cheap text model with a 1M context for fast inference.

    TextText → Text
    • Geringe Kosten
    • Schnelle Antworten
    • Lange Dokumente
    Preise
    $0.03 / $1.28 pro 1 Mio. Tokens, Eingabe / Ausgabe
    Kontextfenster
    1M Kontext
    Sofort in endue nutzbarIm Agenten verwenden
  • DeepSeek

    DeepSeek V3.2

    DeepSeek V3

    Efficient reasoning and tool use at low cost. Text only.

    TextText → Text
    • Geringe Kosten
    • Logisches Denken
    Preise
    $0.26 / $0.42 pro 1 Mio. Tokens, Eingabe / Ausgabe
    Kontextfenster
    164K Kontext
    Sofort in endue nutzbarIm Agenten verwenden
  • Alibaba Qwen

    Qwen3.8 Max

    Qwen3.8

    Largest Qwen, with text, image and video input.

    MultimodalText + Bilder + Video → Text
    • Logisches Denken
    • Programmieren
    • Audio & Video
    Preise
    $2 / $6 pro 1 Mio. Tokens, Eingabe / Ausgabe
    Kontextfenster
    1M Kontext
    Sofort in endue nutzbarIm Agenten verwenden
  • Alibaba Qwen

    Qwen3.8 Flash

    Qwen3.8

    Cheap multimodal Qwen for charts, documents and long videos.

    MultimodalText + Bilder + Video → Text
    • Geringe Kosten
    • Audio & Video
    • Bildverständnis
    Preise
    $0.15 / $0.47 pro 1 Mio. Tokens, Eingabe / Ausgabe
    Kontextfenster
    1M Kontext
    Sofort in endue nutzbarIm Agenten verwenden
  • Alibaba Qwen

    Qwen3.7 Max

    Qwen3.7

    Qwen3.7 flagship for agent work, coding and office tasks. Text only.

    TextText → Text
    • Agentenaufgaben
    • Programmieren
    Preise
    $1.48 / $4.42 pro 1 Mio. Tokens, Eingabe / Ausgabe
    Kontextfenster
    1M Kontext
    Sofort in endue nutzbarIm Agenten verwenden
  • Alibaba Qwen

    Qwen3.7 Plus

    Qwen3.7

    Cost-effective Qwen3.7 with image input.

    TextText + Bilder → Text
    • Geringe Kosten
    • Bildverständnis
    Preise
    $0.32 / $1.28 pro 1 Mio. Tokens, Eingabe / Ausgabe
    Kontextfenster
    1M Kontext
    Sofort in endue nutzbarIm Agenten verwenden
  • Alibaba Qwen

    Qwen3.6 Flash

    Qwen3.6

    Fast Qwen with image and video input and a 1M context.

    MultimodalText + Bilder + Video → Text
    • Schnelle Antworten
    • Geringe Kosten
    • Audio & Video
    Preise
    $0.19 / $1.13 pro 1 Mio. Tokens, Eingabe / Ausgabe
    Kontextfenster
    1M Kontext
    Sofort in endue nutzbarIm Agenten verwenden
  • Alibaba Qwen

    Qwen3 Coder Next

    Qwen3 Coder

    Open-weight coding model for coding agents. No reasoning mode.

    TextText → Text
    • Programmieren
    • Offene Gewichte
    • Geringe Kosten
    Preise
    $0.12 / $0.8 pro 1 Mio. Tokens, Eingabe / Ausgabe
    Kontextfenster
    262K Kontext
    Sofort in endue nutzbarIm Agenten verwenden
  • Z.ai

    GLM-5.3

    GLM-5

    Reasoning model for complex engineering and long agent tasks. Text only.

    TextText → Text
    • Programmieren
    • Agentenaufgaben
    • Lange Dokumente
    Preise
    $0.07 / $7 pro 1 Mio. Tokens, Eingabe / Ausgabe
    Kontextfenster
    1M Kontext
    Sofort in endue nutzbarIm Agenten verwenden
  • Z.ai

    GLM-5.2

    GLM-5

    Project-level software work with a 1M context at a lower price.

    TextText → Text
    • Programmieren
    • Lange Dokumente
    • Geringe Kosten
    Preise
    $0.031 / $12 pro 1 Mio. Tokens, Eingabe / Ausgabe
    Kontextfenster
    1M Kontext
    Sofort in endue nutzbarIm Agenten verwenden
  • Z.ai

    GLM-4.7 Flash

    GLM-4

    Small, very cheap GLM tuned for agentic coding.

    TextText → Text
    • Geringe Kosten
    • Programmieren
    • Schnelle Antworten
    Preise
    $0.061 / $0.4 pro 1 Mio. Tokens, Eingabe / Ausgabe
    Kontextfenster
    200K Kontext
    Sofort in endue nutzbarIm Agenten verwenden
  • Z.ai

    GLM-5V Turbo

    GLM-5V

    GLM that reads images and video, for vision-based coding.

    MultimodalBilder + Text + Video → Text
    • Bildverständnis
    • Programmieren
    • Audio & Video
    Preise
    $1.2 / $4 pro 1 Mio. Tokens, Eingabe / Ausgabe
    Kontextfenster
    203K Kontext
    Sofort in endue nutzbarIm Agenten verwenden
  • MiniMax

    MiniMax M3

    MiniMax

    Multimodal model with a 1M context for long agent work.

    MultimodalText + Bilder + Video → Text
    • Audio & Video
    • Agentenaufgaben
    • Geringe Kosten
    Preise
    $0.3 / $1.2 pro 1 Mio. Tokens, Eingabe / Ausgabe
    Kontextfenster
    1M Kontext
    Sofort in endue nutzbarIm Agenten verwenden
  • MiniMax

    MiniMax M2.7

    MiniMax

    Low-cost text model built for multi-agent productivity.

    TextText → Text
    • Agentenaufgaben
    • Geringe Kosten
    Preise
    $0.21 / $0.84 pro 1 Mio. Tokens, Eingabe / Ausgabe
    Kontextfenster
    205K Kontext
    Sofort in endue nutzbarIm Agenten verwenden
  • Mistral AI

    Mistral Medium 3.5

    Mistral Medium

    Dense 128B model for agent workflows and coding.

    TextText + Bilder + Dateien → Text
    • Agentenaufgaben
    • Programmieren
    Preise
    $1.5 / $7.5 pro 1 Mio. Tokens, Eingabe / Ausgabe
    Kontextfenster
    262K Kontext
    Sofort in endue nutzbarIm Agenten verwenden
  • Mistral AI

    Mistral Large 2512

    Mistral Large

    Mistral’s large general model.

    TextText + Bilder + Dateien → Text
    • Logisches Denken
    Preise
    $0.5 / $1.5 pro 1 Mio. Tokens, Eingabe / Ausgabe
    Kontextfenster
    262K Kontext
    Sofort in endue nutzbarIm Agenten verwenden
  • Mistral AI

    Mistral Small 2603

    Mistral Small

    Mistral Small 4: reasoning and image input in one cheap model.

    TextText + Bilder → Text
    • Geringe Kosten
    • Logisches Denken
    • Bildverständnis
    Preise
    $0.15 / $0.6 pro 1 Mio. Tokens, Eingabe / Ausgabe
    Kontextfenster
    262K Kontext
    Sofort in endue nutzbarIm Agenten verwenden
  • Mistral AI

    Codestral 2508

    Codestral

    Low-latency code completion, fixes and test generation.

    TextText + Dateien → Text
    • Programmieren
    • Schnelle Antworten
    • Geringe Kosten
    Preise
    $0.3 / $0.9 pro 1 Mio. Tokens, Eingabe / Ausgabe
    Kontextfenster
    256K Kontext
    Sofort in endue nutzbarIm Agenten verwenden
  • Mistral AI

    Devstral 2

    Devstral

    Open-source 123B model for agentic coding across a repository.

    TextText + Dateien → Text
    • Programmieren
    • Agentenaufgaben
    • Offene Gewichte
    Preise
    $0.4 / $2 pro 1 Mio. Tokens, Eingabe / Ausgabe
    Kontextfenster
    262K Kontext
    Sofort in endue nutzbarIm Agenten verwenden
  • Mistral AI

    Ministral 14B

    Ministral

    Efficient 14B with image input at a flat low price.

    TextText + Bilder → Text
    • Geringe Kosten
    • Bildverständnis
    • Schnelle Antworten
    Preise
    $0.2 / $0.2 pro 1 Mio. Tokens, Eingabe / Ausgabe
    Kontextfenster
    262K Kontext
    Sofort in endue nutzbarIm Agenten verwenden
  • Meta

    Muse Spark 1.3

    Muse Spark

    Keeps track of long tasks. Reads text, images, audio, video and PDF.

    MultimodalText + Bilder + Video + Dateien → Text
    • Agentenaufgaben
    • Audio & Video
    • Lange Dokumente
    Preise
    $1.25 / $4.25 pro 1 Mio. Tokens, Eingabe / Ausgabe
    Kontextfenster
    1M Kontext
    Sofort in endue nutzbarIm Agenten verwenden
  • Meta

    Muse Spark 1.1

    Muse Spark

    Multimodal reasoning for agent tasks, 1M context.

    MultimodalText + Bilder + Video + Dateien → Text
    • Agentenaufgaben
    • Audio & Video
    Preise
    $1.25 / $4.25 pro 1 Mio. Tokens, Eingabe / Ausgabe
    Kontextfenster
    1M Kontext
    Sofort in endue nutzbarIm Agenten verwenden
  • NVIDIA

    Nemotron 3 Ultra

    Nemotron 3

    Open reasoning model for orchestrating other agents. Text only.

    TextText → Text
    • Logisches Denken
    • Agentenaufgaben
    • Offene Gewichte
    Preise
    $0.5 / $2.2 pro 1 Mio. Tokens, Eingabe / Ausgabe
    Kontextfenster
    262K Kontext
    Sofort in endue nutzbarIm Agenten verwenden
  • NVIDIA

    Nemotron 3 Super

    Nemotron 3

    Open hybrid MoE for multi-agent apps at low compute.

    TextText → Text
    • Offene Gewichte
    • Geringe Kosten
    • Agentenaufgaben
    Preise
    $0.08 / $0.45 pro 1 Mio. Tokens, Eingabe / Ausgabe
    Kontextfenster
    262K Kontext
    Sofort in endue nutzbarIm Agenten verwenden
  • NVIDIA

    Nemotron 3 Nano

    Nemotron 3

    Small open model for narrow, specialized agents.

    TextText → Text
    • Offene Gewichte
    • Geringe Kosten
    • Schnelle Antworten
    Preise
    $0.05 / $0.2 pro 1 Mio. Tokens, Eingabe / Ausgabe
    Kontextfenster
    262K Kontext
    Sofort in endue nutzbarIm Agenten verwenden
  • inclusionAI

    Ling 3.0 Flash

    Ling

    Token-efficient MoE, the cheapest model here. Text only.

    TextText → Text
    • Geringe Kosten
    • Schnelle Antworten
    Preise
    $0.021 / $0.063 pro 1 Mio. Tokens, Eingabe / Ausgabe
    Kontextfenster
    262K Kontext
    Sofort in endue nutzbarIm Agenten verwenden
  • StepFun

    Step 3.7 Flash

    Step

    Efficient MoE with native image and video understanding.

    MultimodalText + Bilder + Video → Text
    • Audio & Video
    • Geringe Kosten
    • Bildverständnis
    Preise
    $0.2 / $1.15 pro 1 Mio. Tokens, Eingabe / Ausgabe
    Kontextfenster
    262K Kontext
    Sofort in endue nutzbarIm Agenten verwenden
  • Perplexity

    Sonar Pro Search

    Sonar

    Searches the web and reasons over results. Cannot call tools.

    TextText + Bilder → Text
    • Webrecherche
    Preise
    $3 / $15 pro 1 Mio. Tokens, Eingabe / Ausgabe
    Kontextfenster
    200K Kontext
    Sofort in endue nutzbarIm Agenten verwenden