영상
보낸 영상을 볼 수 있는 모델입니다. endue 는 아직 영상 생성 모델을 제공하지 않습니다.
- 모델
- 72
- 제공사
- 15
가격·사양 확인일 2026-09-20
- Google
Gemini 3.8 Flash
Gemini Flash최신 Gemini Flash. 텍스트·이미지·오디오·영상을 읽습니다. 1M 컨텍스트.
멀티모달텍스트 + 이미지 + 영상 + 파일 + 오디오 → 텍스트- 오디오·영상
- 에이전트 작업
- 긴 문서
- 가격
- $0.75 / $3.75 1M 토큰당 입력 / 출력
- 컨텍스트
- 1M 컨텍스트
endue 에서 바로 사용에이전트에 쓰기 - Google
Gemini 3.5 Flash
Gemini FlashFlash 가격으로 Pro 에 가까운 코딩·추론, 병렬 도구 실행.
멀티모달텍스트 + 이미지 + 영상 + 파일 + 오디오 → 텍스트- 코딩
- 오디오·영상
- 에이전트 작업
- 가격
- $1.5 / $9 1M 토큰당 입력 / 출력
- 컨텍스트
- 1M 컨텍스트
endue 에서 바로 사용에이전트에 쓰기 - Google
Gemini 3.6 Flash
Gemini Flash웹·앱 개발용 Flash. 불필요한 수정이 적습니다.
멀티모달텍스트 + 이미지 + 영상 + 파일 + 오디오 → 텍스트- 코딩
- 오디오·영상
- 가격
- $0.75 / $3.75 1M 토큰당 입력 / 출력
- 컨텍스트
- 1M 컨텍스트
endue 에서 바로 사용에이전트에 쓰기 - Google
Gemini 3.5 Flash Lite
Gemini Flash-Lite좁은 작업을 맡는 하위 에이전트용 저가 Gemini.
멀티모달텍스트 + 이미지 + 영상 + 파일 + 오디오 → 텍스트- 저비용
- 오디오·영상
- 빠른 응답
- 가격
- $0.3 / $2.5 1M 토큰당 입력 / 출력
- 컨텍스트
- 1M 컨텍스트
endue 에서 바로 사용에이전트에 쓰기 - Google
Gemini 2.5 Pro
Gemini Pro수학·과학·코드를 단계적으로 푸는 Gemini.
멀티모달텍스트 + 이미지 + 파일 + 오디오 + 영상 → 텍스트- 추론
- 오디오·영상
- 긴 문서
- 가격
- $1.25 / $10 1M 토큰당 입력 / 출력
- 컨텍스트
- 1M 컨텍스트
endue 에서 바로 사용에이전트에 쓰기 - Google
Gemini 3.1 Flash Lite
Gemini Flash-Lite대량 처리용 저지연 Gemini. 오디오·영상·PDF 를 읽습니다.
멀티모달텍스트 + 이미지 + 영상 + 파일 + 오디오 → 텍스트- 저비용
- 빠른 응답
- 오디오·영상
- 가격
- $0.25 / $1.5 1M 토큰당 입력 / 출력
- 컨텍스트
- 1M 컨텍스트
endue 에서 바로 사용에이전트에 쓰기 - Google
Gemini 2.5 Flash Lite
Gemini Flash-Lite이 목록에서 가장 싼 멀티모달 모델 중 하나, 1M 컨텍스트.
멀티모달텍스트 + 이미지 + 파일 + 오디오 + 영상 → 텍스트- 저비용
- 빠른 응답
- 오디오·영상
- 가격
- $0.1 / $0.4 1M 토큰당 입력 / 출력
- 컨텍스트
- 1M 컨텍스트
endue 에서 바로 사용에이전트에 쓰기 - Google
Gemma 4 31B
Gemma 4이미지·영상 입력과 함수 호출을 갖춘 오픈 웨이트 dense 모델.
멀티모달이미지 + 텍스트 + 영상 → 텍스트- 오픈 웨이트
- 저비용
- 이미지 이해
- 가격
- $0.09 / $0.34 1M 토큰당 입력 / 출력
- 컨텍스트
- 262K 컨텍스트
endue 에서 바로 사용에이전트에 쓰기 - Google
Gemma 4 26B
Gemma 4Gemma 4 31B 에 가까운 품질을 더 적은 연산으로 내는 오픈 웨이트 MoE.
멀티모달이미지 + 텍스트 + 영상 → 텍스트- 오픈 웨이트
- 저비용
- 빠른 응답
- 가격
- $0.09 / $0.3 1M 토큰당 입력 / 출력
- 컨텍스트
- 262K 컨텍스트
endue 에서 바로 사용에이전트에 쓰기 - Moonshot AI
Kimi K3
Kimi코딩과 긴 에이전트 작업용 대형 오픈 웨이트 멀티모달 모델.
멀티모달텍스트 + 이미지 + 영상 → 텍스트- 코딩
- 에이전트 작업
- 오픈 웨이트
- 가격
- $1.7 / $8.5 1M 토큰당 입력 / 출력
- 컨텍스트
- 1M 컨텍스트
endue 에서 바로 사용에이전트에 쓰기 - Alibaba Qwen
Qwen3.8 Max
Qwen3.8가장 큰 Qwen. 텍스트·이미지·영상 입력.
멀티모달텍스트 + 이미지 + 영상 → 텍스트- 추론
- 코딩
- 오디오·영상
- 가격
- $2 / $6 1M 토큰당 입력 / 출력
- 컨텍스트
- 1M 컨텍스트
endue 에서 바로 사용에이전트에 쓰기 - Alibaba Qwen
Qwen3.8 Flash
Qwen3.8차트·문서·긴 영상 분석용 저가 멀티모달 Qwen.
멀티모달텍스트 + 이미지 + 영상 → 텍스트- 저비용
- 오디오·영상
- 이미지 이해
- 가격
- $0.15 / $0.47 1M 토큰당 입력 / 출력
- 컨텍스트
- 1M 컨텍스트
endue 에서 바로 사용에이전트에 쓰기 - Alibaba Qwen
Qwen3.6 Flash
Qwen3.6이미지·영상 입력과 1M 컨텍스트의 빠른 Qwen.
멀티모달텍스트 + 이미지 + 영상 → 텍스트- 빠른 응답
- 저비용
- 오디오·영상
- 가격
- $0.19 / $1.13 1M 토큰당 입력 / 출력
- 컨텍스트
- 1M 컨텍스트
endue 에서 바로 사용에이전트에 쓰기 - Z.ai
GLM-5V Turbo
GLM-5V이미지와 영상을 읽는 GLM. 화면을 보고 코딩하는 작업용.
멀티모달이미지 + 텍스트 + 영상 → 텍스트- 이미지 이해
- 코딩
- 오디오·영상
- 가격
- $1.2 / $4 1M 토큰당 입력 / 출력
- 컨텍스트
- 203K 컨텍스트
endue 에서 바로 사용에이전트에 쓰기 - MiniMax
MiniMax M3
MiniMax긴 에이전트 작업용 1M 컨텍스트 멀티모달 모델.
멀티모달텍스트 + 이미지 + 영상 → 텍스트- 오디오·영상
- 에이전트 작업
- 저비용
- 가격
- $0.3 / $1.2 1M 토큰당 입력 / 출력
- 컨텍스트
- 1M 컨텍스트
endue 에서 바로 사용에이전트에 쓰기 - Meta
Muse Spark 1.3
Muse Spark긴 작업의 맥락을 놓치지 않습니다. 텍스트·이미지·오디오·영상·PDF 입력.
멀티모달텍스트 + 이미지 + 영상 + 파일 + 오디오 → 텍스트- 에이전트 작업
- 오디오·영상
- 긴 문서
- 가격
- $1.25 / $4.25 1M 토큰당 입력 / 출력
- 컨텍스트
- 1M 컨텍스트
endue 에서 바로 사용에이전트에 쓰기 - Meta
Muse Spark 1.1
Muse Spark에이전트 작업용 멀티모달 추론 모델, 1M 컨텍스트.
멀티모달텍스트 + 이미지 + 영상 + 파일 + 오디오 → 텍스트- 에이전트 작업
- 오디오·영상
- 가격
- $1.25 / $4.25 1M 토큰당 입력 / 출력
- 컨텍스트
- 1M 컨텍스트
endue 에서 바로 사용에이전트에 쓰기 - StepFun
Step 3.7 Flash
Step이미지·영상을 직접 이해하는 효율형 MoE.
멀티모달텍스트 + 이미지 + 영상 → 텍스트- 오디오·영상
- 저비용
- 이미지 이해
- 가격
- $0.2 / $1.15 1M 토큰당 입력 / 출력
- 컨텍스트
- 262K 컨텍스트
endue 에서 바로 사용에이전트에 쓰기
조건에 맞는 모델이 없습니다.