모델 ID:
deepseek/deepseek-v4-flash | 엔드포인트 ID: deepseek-v4-flash | 파라미터: 284B (MoE, 활성 13B) | 출시일: 2026-04-24개요
DeepSeek V4 Flash는 DeepSeek의 효율 최적화 Mixture-of-Experts 모델입니다. 총 284B 파라미터 중 토큰당 13B만 활성화해 빠른 응답과 낮은 비용을 제공합니다. 코딩 어시스턴트, 챗봇, 에이전트 워크플로처럼 속도와 비용이 중요한 워크로드에 적합합니다. 최대 131,072 토큰의 컨텍스트를 지원합니다.Air API Playground
플레이그라운드에서 모델을 체험하세요.
AIR Container로 배포
AIR Container로 배포하세요.
OpenAI 호환 API
OpenAI SDK 그대로 연동하세요.
가격
지원 기능
모든 기능은 OpenAI 호환 API로 사용할 수 있습니다.주요 기능
- MoE 희소 활성화(284B 중 13B)로 빠르고 저렴한 추론
- 추론(thinking) 지원 — 필요 없을 때는 끌 수 있음
- Tool calling과 JSON 모드 지원
- 코딩·에이전트 워크로드에 최적화
활용 사례
코딩 어시스턴트
실용적인 개발 작업을 위해 코드를 생성하고 설명합니다.에이전트 워크플로
일반 챗
일상적인 대화와 범용 Q&A를 빠르고 낮은 비용으로 처리합니다.파라미터
모델 세부정보
시작하기
1
API 키 발급하기
AirCloud 계정에서 API 키를 발급받습니다.
2
코드 실행하기
아래 코드에서
YOUR_API_KEY 자리에 실제 발급받은 키를 넣어 실행하세요. 언어별(Python, cURL, Node.js) 코드 예시를 선택할 수 있습니다.태그
open-source conversational moe reasoning efficient
