endueendue

StepFun

Step 3.7 Flash

stepfun/step-3.7-flash

Efficient MoE with native image and video understanding.

MultimodalTexte, Images, Vidéo → TexteDisponible sur endue
  • Audio et vidéo
  • Faible coût
  • Analyse d’images

Vue d’ensemble

Adapté à

Rédigé par endue

  • Audio et vidéo
  • Faible coût
  • Analyse d’images

Moins adapté à

D’après les caractéristiques du modèle

Rien dans les caractéristiques n’exclut les tâches courantes d’un agent.

Capacités

Tool usePris en charge
Structured outputPris en charge
JSON modePris en charge
ReasoningPris en charge
VisionPris en charge
Audio inputNon pris en charge
Video inputPris en charge
File inputNon pris en charge
Long contextPris en charge

Caractéristiques

ID du modèle
stepfun/step-3.7-flash
Famille
Step
Fenêtre de contexte
262K tokens
Entrée
Texte, Images, Vidéo
Sortie
Texte
Date de sortie
2026-05-28