endueendue

Bild

Modelle, die Bilder lesen können, die Sie senden. endue bietet noch keine Modelle zur Bilderzeugung an.

Modelle
73
Anbieter
15

Preise und Spezifikationen geprüft am 2026-10-05

56 Modelle

Modelle filtern

Anbieter
Liest
Fähigkeiten
Geeignet für
  • xAI

    Grok 4.6

    Grok 4

    xAI’s top Grok for coding, STEM and knowledge work.

    TextText + Bilder + Dateien → Text
    • Programmieren
    • Logisches Denken
    • Lange Dokumente
    Preise
    $2 / $6 pro 1 Mio. Tokens, Eingabe / Ausgabe
    Kontextfenster
    500K Kontext
    Sofort in endue nutzbarIm Agenten verwenden
  • xAI

    Grok 4.3

    Grok 4

    Reasoning model that follows instructions closely, with a 1M context. endue’s default.

    TextText + Bilder + Dateien → Text
    • Agentenaufgaben
    • Logisches Denken
    • Lange Dokumente
    Preise
    $1.25 / $2.5 pro 1 Mio. Tokens, Eingabe / Ausgabe
    Kontextfenster
    1M Kontext
    Sofort in endue nutzbarIm Agenten verwenden
  • xAI

    Grok 4.20

    Grok 4

    Fast tool calling with a 2M context for very long inputs.

    TextText + Bilder + Dateien → Text
    • Agentenaufgaben
    • Lange Dokumente
    • Schnelle Antworten
    Preise
    $1.25 / $2.5 pro 1 Mio. Tokens, Eingabe / Ausgabe
    Kontextfenster
    2M Kontext
    Sofort in endue nutzbarIm Agenten verwenden
  • xAI

    Grok 4.5

    Grok 4

    Balanced Grok for coding and knowledge work, 500K context.

    TextText + Bilder + Dateien → Text
    • Programmieren
    • Logisches Denken
    Preise
    $2 / $6 pro 1 Mio. Tokens, Eingabe / Ausgabe
    Kontextfenster
    500K Kontext
    Sofort in endue nutzbarIm Agenten verwenden
  • xAI

    Grok Build 0.1

    Grok Build

    Fast coding model tuned for interactive software engineering.

    TextText + Bilder + Dateien → Text
    • Programmieren
    • Schnelle Antworten
    • Geringe Kosten
    Preise
    $1 / $2 pro 1 Mio. Tokens, Eingabe / Ausgabe
    Kontextfenster
    256K Kontext
    Sofort in endue nutzbarIm Agenten verwenden
  • OpenAI

    GPT-6 Astra

    GPT-6

    OpenAI’s flagship for long, demanding work: analysis, research, large codebases.

    TextDateien + Bilder + Text → Text
    • Logisches Denken
    • Programmieren
    • Lange Dokumente
    Preise
    $10 / $50 pro 1 Mio. Tokens, Eingabe / Ausgabe
    Kontextfenster
    1.1M Kontext
    Sofort in endue nutzbarIm Agenten verwenden
  • OpenAI

    GPT-6 Astra Pro

    GPT-6

    GPT-6 Astra with deeper reasoning per answer. Same price, slower replies.

    TextDateien + Bilder + Text → Text
    • Logisches Denken
    • Webrecherche
    Preise
    $10 / $50 pro 1 Mio. Tokens, Eingabe / Ausgabe
    Kontextfenster
    1.1M Kontext
    Sofort in endue nutzbarIm Agenten verwenden
  • OpenAI

    GPT-5.6 Sol

    GPT-5.6

    Top GPT-5.6 tier, strong at multi-step and command-line coding.

    TextDateien + Bilder + Text → Text
    • Programmieren
    • Agentenaufgaben
    • Logisches Denken
    Preise
    $2 / $10 pro 1 Mio. Tokens, Eingabe / Ausgabe
    Kontextfenster
    1.1M Kontext
    Sofort in endue nutzbarIm Agenten verwenden
  • OpenAI

    GPT-5.6 Terra

    GPT-5.6

    Middle GPT-5.6 tier for everyday coding and agent tasks.

    TextDateien + Bilder + Text → Text
    • Programmieren
    • Agentenaufgaben
    Preise
    $2 / $12 pro 1 Mio. Tokens, Eingabe / Ausgabe
    Kontextfenster
    1.1M Kontext
    Sofort in endue nutzbarIm Agenten verwenden
  • OpenAI

    GPT-5.6 Luna

    GPT-5.6

    Cheap, fast GPT-5.6 tier for chat, classification and high volume.

    TextDateien + Bilder + Text → Text
    • Schnelle Antworten
    • Geringe Kosten
    • Lange Dokumente
    Preise
    $0.2 / $1.2 pro 1 Mio. Tokens, Eingabe / Ausgabe
    Kontextfenster
    1.1M Kontext
    Sofort in endue nutzbarIm Agenten verwenden
  • OpenAI

    GPT-5.5

    GPT-5

    Reliable reasoning for professional workloads, 1M context.

    TextDateien + Bilder + Text → Text
    • Logisches Denken
    • Lange Dokumente
    Preise
    $5 / $30 pro 1 Mio. Tokens, Eingabe / Ausgabe
    Kontextfenster
    1.1M Kontext
    Sofort in endue nutzbarIm Agenten verwenden
  • OpenAI

    GPT-5.4

    GPT-5

    Codex and GPT merged into one model, with a 1M context.

    TextText + Bilder + Dateien → Text
    • Programmieren
    • Logisches Denken
    • Lange Dokumente
    Preise
    $2.5 / $15 pro 1 Mio. Tokens, Eingabe / Ausgabe
    Kontextfenster
    1.1M Kontext
    Sofort in endue nutzbarIm Agenten verwenden
  • OpenAI

    GPT-5.4 Mini

    GPT-5

    Smaller GPT-5.4 for high-throughput reasoning and coding.

    TextDateien + Bilder + Text → Text
    • Schnelle Antworten
    • Programmieren
    Preise
    $0.75 / $4.5 pro 1 Mio. Tokens, Eingabe / Ausgabe
    Kontextfenster
    400K Kontext
    Sofort in endue nutzbarIm Agenten verwenden
  • OpenAI

    GPT-5.4 Nano

    GPT-5

    Lightest GPT-5.4 for latency-sensitive, high-volume tasks.

    TextDateien + Bilder + Text → Text
    • Schnelle Antworten
    • Geringe Kosten
    Preise
    $0.2 / $1.25 pro 1 Mio. Tokens, Eingabe / Ausgabe
    Kontextfenster
    400K Kontext
    Sofort in endue nutzbarIm Agenten verwenden
  • OpenAI

    GPT-5.3 Codex

    GPT-5 Codex

    OpenAI’s agentic coding model for long software tasks.

    TextText + Bilder + Dateien → Text
    • Programmieren
    • Agentenaufgaben
    Preise
    $1.75 / $14 pro 1 Mio. Tokens, Eingabe / Ausgabe
    Kontextfenster
    400K Kontext
    Sofort in endue nutzbarIm Agenten verwenden
  • OpenAI

    GPT-5

    GPT-5

    Step-by-step reasoning with careful instruction following.

    TextText + Bilder + Dateien → Text
    • Logisches Denken
    • Programmieren
    Preise
    $1.25 / $10 pro 1 Mio. Tokens, Eingabe / Ausgabe
    Kontextfenster
    400K Kontext
    Sofort in endue nutzbarIm Agenten verwenden
  • OpenAI

    GPT-4o mini

    GPT-4o

    Small non-reasoning model for quick, inexpensive replies.

    TextText + Bilder + Dateien → Text
    • Schnelle Antworten
    • Geringe Kosten
    Preise
    $0.15 / $0.6 pro 1 Mio. Tokens, Eingabe / Ausgabe
    Kontextfenster
    128K Kontext
    Sofort in endue nutzbarIm Agenten verwenden
  • Anthropic

    Claude Opus 5

    Claude Opus

    Anthropic’s flagship for code review, bug finding and long agent runs.

    TextText + Bilder + Dateien → Text
    • Programmieren
    • Agentenaufgaben
    • Logisches Denken
    Preise
    $5 / $25 pro 1 Mio. Tokens, Eingabe / Ausgabe
    Kontextfenster
    1M Kontext
    Sofort in endue nutzbarIm Agenten verwenden
  • Anthropic

    Claude Fable 5.1

    Claude Fable

    Fable 5 improved for long refactors, front-end work and knowledge tasks.

    TextText + Bilder + Dateien → Text
    • Programmieren
    • Agentenaufgaben
    • Lange Dokumente
    Preise
    $10 / $50 pro 1 Mio. Tokens, Eingabe / Ausgabe
    Kontextfenster
    1M Kontext
    Sofort in endue nutzbarIm Agenten verwenden
  • Anthropic

    Claude Fable 5

    Claude Fable

    Built for autonomous knowledge work and coding.

    TextText + Bilder + Dateien → Text
    • Agentenaufgaben
    • Programmieren
    Preise
    $10 / $50 pro 1 Mio. Tokens, Eingabe / Ausgabe
    Kontextfenster
    1M Kontext
    Sofort in endue nutzbarIm Agenten verwenden
  • Anthropic

    Claude Opus 4.8

    Claude Opus

    Latest Opus 4 release, 1M context.

    TextText + Bilder + Dateien → Text
    • Programmieren
    • Logisches Denken
    • Lange Dokumente
    Preise
    $5 / $25 pro 1 Mio. Tokens, Eingabe / Ausgabe
    Kontextfenster
    1M Kontext
    Sofort in endue nutzbarIm Agenten verwenden
  • Anthropic

    Claude Sonnet 5

    Claude Sonnet

    Strong coding and agent work at a lower price than Opus.

    TextText + Bilder + Dateien → Text
    • Programmieren
    • Agentenaufgaben
    Preise
    $2 / $10 pro 1 Mio. Tokens, Eingabe / Ausgabe
    Kontextfenster
    1M Kontext
    Sofort in endue nutzbarIm Agenten verwenden
  • Anthropic

    Claude Sonnet 4.5

    Claude Sonnet

    Sonnet tuned for real-world agents and coding workflows.

    TextText + Bilder + Dateien → Text
    • Programmieren
    • Agentenaufgaben
    Preise
    $3 / $15 pro 1 Mio. Tokens, Eingabe / Ausgabe
    Kontextfenster
    1M Kontext
    Sofort in endue nutzbarIm Agenten verwenden
  • Anthropic

    Claude Haiku 4.5

    Claude Haiku

    Fastest Claude, near Sonnet 4 quality at lower cost.

    TextText + Bilder + Dateien → Text
    • Schnelle Antworten
    • Geringe Kosten
    Preise
    $1 / $5 pro 1 Mio. Tokens, Eingabe / Ausgabe
    Kontextfenster
    200K Kontext
    Sofort in endue nutzbarIm Agenten verwenden
  • Anthropic

    Claude Opus 4.7

    Claude Opus

    Opus for long-running, asynchronous agents.

    TextText + Bilder + Dateien → Text
    • Agentenaufgaben
    • Programmieren
    Preise
    $5 / $25 pro 1 Mio. Tokens, Eingabe / Ausgabe
    Kontextfenster
    1M Kontext
    Sofort in endue nutzbarIm Agenten verwenden
  • Anthropic

    Claude Opus 4.6

    Claude Opus

    Opus for agents that run whole workflows, not single prompts.

    TextText + Bilder + Dateien → Text
    • Agentenaufgaben
    • Programmieren
    Preise
    $5 / $25 pro 1 Mio. Tokens, Eingabe / Ausgabe
    Kontextfenster
    1M Kontext
    Sofort in endue nutzbarIm Agenten verwenden
  • Anthropic

    Claude Sonnet 4.6

    Claude Sonnet

    Iterative development and navigating large codebases.

    TextText + Bilder + Dateien → Text
    • Programmieren
    • Agentenaufgaben
    Preise
    $3 / $15 pro 1 Mio. Tokens, Eingabe / Ausgabe
    Kontextfenster
    1M Kontext
    Sofort in endue nutzbarIm Agenten verwenden
  • Anthropic

    Claude Opus 4.5

    Claude Opus

    Opus for complex software engineering and computer use, 200K context.

    TextDateien + Bilder + Text → Text
    • Programmieren
    • Agentenaufgaben
    Preise
    $5 / $25 pro 1 Mio. Tokens, Eingabe / Ausgabe
    Kontextfenster
    200K Kontext
    Sofort in endue nutzbarIm Agenten verwenden
  • Anthropic

    Claude Opus 4.1

    Claude Opus

    Earlier Opus. The most expensive Claude here; newer Opus models cost less.

    TextBilder + Text + Dateien → Text
    • Programmieren
    • Logisches Denken
    Preise
    $15 / $75 pro 1 Mio. Tokens, Eingabe / Ausgabe
    Kontextfenster
    200K Kontext
    Sofort in endue nutzbarIm Agenten verwenden
  • Google

    Gemini 3.8 Flash

    Gemini Flash

    Latest Gemini Flash. Reads text, images, audio and video; 1M context.

    MultimodalText + Bilder + Video + Dateien + Audio → Text
    • Audio & Video
    • Agentenaufgaben
    • Lange Dokumente
    Preise
    $0.75 / $3.75 pro 1 Mio. Tokens, Eingabe / Ausgabe
    Kontextfenster
    1M Kontext
    Sofort in endue nutzbarIm Agenten verwenden
  • Google

    Gemini 3.5 Flash

    Gemini Flash

    Near-Pro coding and reasoning at Flash cost, with parallel tool use.

    MultimodalText + Bilder + Video + Dateien + Audio → Text
    • Programmieren
    • Audio & Video
    • Agentenaufgaben
    Preise
    $1.5 / $9 pro 1 Mio. Tokens, Eingabe / Ausgabe
    Kontextfenster
    1M Kontext
    Sofort in endue nutzbarIm Agenten verwenden
  • Google

    Gemini 3.6 Flash

    Gemini Flash

    Flash model for coding and web/app development with fewer stray edits.

    MultimodalText + Bilder + Video + Dateien + Audio → Text
    • Programmieren
    • Audio & Video
    Preise
    $0.75 / $3.75 pro 1 Mio. Tokens, Eingabe / Ausgabe
    Kontextfenster
    1M Kontext
    Sofort in endue nutzbarIm Agenten verwenden
  • Google

    Gemini 3.5 Flash Lite

    Gemini Flash-Lite

    Cheap Gemini for sub-agents that run focused tasks.

    MultimodalText + Bilder + Video + Dateien + Audio → Text
    • Geringe Kosten
    • Audio & Video
    • Schnelle Antworten
    Preise
    $0.3 / $2.5 pro 1 Mio. Tokens, Eingabe / Ausgabe
    Kontextfenster
    1M Kontext
    Sofort in endue nutzbarIm Agenten verwenden
  • Google

    Gemini 2.5 Pro

    Gemini Pro

    Gemini with step-by-step thinking for math, science and code.

    MultimodalText + Bilder + Dateien + Audio + Video → Text
    • Logisches Denken
    • Audio & Video
    • Lange Dokumente
    Preise
    $1.25 / $10 pro 1 Mio. Tokens, Eingabe / Ausgabe
    Kontextfenster
    1M Kontext
    Sofort in endue nutzbarIm Agenten verwenden
  • Google

    Gemini 3.1 Flash Lite

    Gemini Flash-Lite

    Low-latency Gemini for high volume. Reads audio, video and PDF.

    MultimodalText + Bilder + Video + Dateien + Audio → Text
    • Geringe Kosten
    • Schnelle Antworten
    • Audio & Video
    Preise
    $0.25 / $1.5 pro 1 Mio. Tokens, Eingabe / Ausgabe
    Kontextfenster
    1M Kontext
    Sofort in endue nutzbarIm Agenten verwenden
  • Google

    Gemini 2.5 Flash Lite

    Gemini Flash-Lite

    Among the cheapest multimodal models here, 1M context.

    MultimodalText + Bilder + Dateien + Audio + Video → Text
    • Geringe Kosten
    • Schnelle Antworten
    • Audio & Video
    Preise
    $0.1 / $0.4 pro 1 Mio. Tokens, Eingabe / Ausgabe
    Kontextfenster
    1M Kontext
    Sofort in endue nutzbarIm Agenten verwenden
  • Google

    Gemma 4 31B

    Gemma 4

    Open-weight dense model with image and video input and function calling.

    MultimodalBilder + Text + Video → Text
    • Offene Gewichte
    • Geringe Kosten
    • Bildverständnis
    Preise
    $0.09 / $0.34 pro 1 Mio. Tokens, Eingabe / Ausgabe
    Kontextfenster
    262K Kontext
    Sofort in endue nutzbarIm Agenten verwenden
  • Google

    Gemma 4 26B

    Gemma 4

    Open-weight MoE close to Gemma 4 31B quality at lower compute.

    MultimodalBilder + Text + Video → Text
    • Offene Gewichte
    • Geringe Kosten
    • Schnelle Antworten
    Preise
    $0.077 / $0.26 pro 1 Mio. Tokens, Eingabe / Ausgabe
    Kontextfenster
    262K Kontext
    Sofort in endue nutzbarIm Agenten verwenden
  • Moonshot AI

    Kimi K3

    Kimi

    Large open-weight multimodal model for coding and long agent runs.

    MultimodalText + Bilder + Video → Text
    • Programmieren
    • Agentenaufgaben
    • Offene Gewichte
    Preise
    $1.19 / $14 pro 1 Mio. Tokens, Eingabe / Ausgabe
    Kontextfenster
    1M Kontext
    Sofort in endue nutzbarIm Agenten verwenden
  • Moonshot AI

    Kimi K2.7 Code

    Kimi

    Coding-focused Kimi for end-to-end programming over long contexts.

    TextText + Bilder → Text
    • Programmieren
    • Agentenaufgaben
    Preise
    $0.67 / $3.35 pro 1 Mio. Tokens, Eingabe / Ausgabe
    Kontextfenster
    262K Kontext
    Sofort in endue nutzbarIm Agenten verwenden
  • Moonshot AI

    Kimi K2.6

    Kimi

    Long coding tasks, UI generation from code and multi-agent setups.

    TextText + Bilder → Text
    • Programmieren
    • Agentenaufgaben
    • Bildverständnis
    Preise
    $0.95 / $4 pro 1 Mio. Tokens, Eingabe / Ausgabe
    Kontextfenster
    262K Kontext
    Sofort in endue nutzbarIm Agenten verwenden
  • DeepSeek

    DeepSeek V4.1 Flash

    DeepSeek V4

    Low-cost DeepSeek with image input and a 1M context.

    TextText + Bilder → Text
    • Geringe Kosten
    • Lange Dokumente
    • Bildverständnis
    Preise
    $0.3 / $1.2 pro 1 Mio. Tokens, Eingabe / Ausgabe
    Kontextfenster
    1M Kontext
    Sofort in endue nutzbarIm Agenten verwenden
  • Alibaba Qwen

    Qwen3.8 Max

    Qwen3.8

    Largest Qwen, with text, image and video input.

    MultimodalText + Bilder + Video → Text
    • Logisches Denken
    • Programmieren
    • Audio & Video
    Preise
    $2 / $6 pro 1 Mio. Tokens, Eingabe / Ausgabe
    Kontextfenster
    1M Kontext
    Sofort in endue nutzbarIm Agenten verwenden
  • Alibaba Qwen

    Qwen3.8 Flash

    Qwen3.8

    Cheap multimodal Qwen for charts, documents and long videos.

    MultimodalText + Bilder + Video → Text
    • Geringe Kosten
    • Audio & Video
    • Bildverständnis
    Preise
    $0.15 / $0.47 pro 1 Mio. Tokens, Eingabe / Ausgabe
    Kontextfenster
    1M Kontext
    Sofort in endue nutzbarIm Agenten verwenden
  • Alibaba Qwen

    Qwen3.7 Plus

    Qwen3.7

    Cost-effective Qwen3.7 with image input.

    TextText + Bilder → Text
    • Geringe Kosten
    • Bildverständnis
    Preise
    $0.32 / $1.28 pro 1 Mio. Tokens, Eingabe / Ausgabe
    Kontextfenster
    1M Kontext
    Sofort in endue nutzbarIm Agenten verwenden
  • Alibaba Qwen

    Qwen3.6 Flash

    Qwen3.6

    Fast Qwen with image and video input and a 1M context.

    MultimodalText + Bilder + Video → Text
    • Schnelle Antworten
    • Geringe Kosten
    • Audio & Video
    Preise
    $0.19 / $1.13 pro 1 Mio. Tokens, Eingabe / Ausgabe
    Kontextfenster
    1M Kontext
    Sofort in endue nutzbarIm Agenten verwenden
  • Z.ai

    GLM-5V Turbo

    GLM-5V

    GLM that reads images and video, for vision-based coding.

    MultimodalBilder + Text + Video → Text
    • Bildverständnis
    • Programmieren
    • Audio & Video
    Preise
    $1.2 / $4 pro 1 Mio. Tokens, Eingabe / Ausgabe
    Kontextfenster
    203K Kontext
    Sofort in endue nutzbarIm Agenten verwenden
  • MiniMax

    MiniMax M3

    MiniMax

    Multimodal model with a 1M context for long agent work.

    MultimodalText + Bilder + Video → Text
    • Audio & Video
    • Agentenaufgaben
    • Geringe Kosten
    Preise
    $0.3 / $1.2 pro 1 Mio. Tokens, Eingabe / Ausgabe
    Kontextfenster
    1M Kontext
    Sofort in endue nutzbarIm Agenten verwenden
  • Mistral AI

    Mistral Medium 3.5

    Mistral Medium

    Dense 128B model for agent workflows and coding.

    TextText + Bilder + Dateien → Text
    • Agentenaufgaben
    • Programmieren
    Preise
    $1.5 / $7.5 pro 1 Mio. Tokens, Eingabe / Ausgabe
    Kontextfenster
    262K Kontext
    Sofort in endue nutzbarIm Agenten verwenden
  • Mistral AI

    Mistral Large 2512

    Mistral Large

    Mistral’s large general model.

    TextText + Bilder + Dateien → Text
    • Logisches Denken
    Preise
    $0.5 / $1.5 pro 1 Mio. Tokens, Eingabe / Ausgabe
    Kontextfenster
    262K Kontext
    Sofort in endue nutzbarIm Agenten verwenden
  • Mistral AI

    Mistral Small 2603

    Mistral Small

    Mistral Small 4: reasoning and image input in one cheap model.

    TextText + Bilder → Text
    • Geringe Kosten
    • Logisches Denken
    • Bildverständnis
    Preise
    $0.15 / $0.6 pro 1 Mio. Tokens, Eingabe / Ausgabe
    Kontextfenster
    262K Kontext
    Sofort in endue nutzbarIm Agenten verwenden
  • Mistral AI

    Ministral 14B

    Ministral

    Efficient 14B with image input at a flat low price.

    TextText + Bilder → Text
    • Geringe Kosten
    • Bildverständnis
    • Schnelle Antworten
    Preise
    $0.2 / $0.2 pro 1 Mio. Tokens, Eingabe / Ausgabe
    Kontextfenster
    262K Kontext
    Sofort in endue nutzbarIm Agenten verwenden
  • Meta

    Muse Spark 1.3

    Muse Spark

    Keeps track of long tasks. Reads text, images, audio, video and PDF.

    MultimodalText + Bilder + Video + Dateien → Text
    • Agentenaufgaben
    • Audio & Video
    • Lange Dokumente
    Preise
    $1.25 / $4.25 pro 1 Mio. Tokens, Eingabe / Ausgabe
    Kontextfenster
    1M Kontext
    Sofort in endue nutzbarIm Agenten verwenden
  • Meta

    Muse Spark 1.1

    Muse Spark

    Multimodal reasoning for agent tasks, 1M context.

    MultimodalText + Bilder + Video + Dateien → Text
    • Agentenaufgaben
    • Audio & Video
    Preise
    $1.25 / $4.25 pro 1 Mio. Tokens, Eingabe / Ausgabe
    Kontextfenster
    1M Kontext
    Sofort in endue nutzbarIm Agenten verwenden
  • StepFun

    Step 3.7 Flash

    Step

    Efficient MoE with native image and video understanding.

    MultimodalText + Bilder + Video → Text
    • Audio & Video
    • Geringe Kosten
    • Bildverständnis
    Preise
    $0.2 / $1.15 pro 1 Mio. Tokens, Eingabe / Ausgabe
    Kontextfenster
    262K Kontext
    Sofort in endue nutzbarIm Agenten verwenden
  • Perplexity

    Sonar Pro Search

    Sonar

    Searches the web and reasons over results. Cannot call tools.

    TextText + Bilder → Text
    • Webrecherche
    Preise
    $3 / $15 pro 1 Mio. Tokens, Eingabe / Ausgabe
    Kontextfenster
    200K Kontext
    Sofort in endue nutzbarIm Agenten verwenden