DeepSeek v4 API
DeepSeek가 구동하는 DeepSeek v4 LLM 모델의 전체 API 레퍼런스입니다.
모델 업데이트
DeepSeek v4 Flash 0731
- Flaq AI는 DeepSeek v4 Flash를 DeepSeek의 공식
deepseek-v4-flash-0731 릴리스로 업데이트했습니다.
- 업데이트된 버전에 액세스하려면 아래의
0731 모델 ID를 사용하세요.
- 기존 모델 ID는 현재 API 통합에서 계속 사용할 수 있습니다.
모델 변형
이 API는 네 가지 DeepSeek v4 모델 변형을 지원합니다.
빠른 비교
DeepSeek v4 Pro Text to Text
엔드포인트 {#}
POST /api/v1/chat/completions
요청 파라미터
필수
메시지 지원
선택 사항
요청 예시
const response = await fetch('https://api.flaq.ai/api/v1/chat/completions', {
method: 'POST',
headers: {
'Authorization': 'Bearer YOUR_API_KEY',
'Accept': 'text/event-stream',
'Content-Type': 'application/json'
},
body: JSON.stringify({
model: 'deepseek-v4-pro-text-to-text',
messages: [
{
role: 'user',
content: 'Hello'
}
],
stream: true,
max_tokens: 500,
top_p: 0.5,
top_k: 1
})
});
DeepSeek v4 Flash Text to Text
엔드포인트
POST /api/v1/chat/completions
요청 파라미터
필수
메시지 지원
선택 사항
요청 예시
const response = await fetch('https://api.flaq.ai/api/v1/chat/completions', {
method: 'POST',
headers: {
'Authorization': 'Bearer YOUR_API_KEY',
'Accept': 'application/json',
'Content-Type': 'application/json'
},
body: JSON.stringify({
model: 'deepseek-v4-flash-text-to-text',
messages: [
{
role: 'user',
content: 'Write a four-line modern poem about a programmer drinking coffee.'
}
],
stream: false,
max_tokens: 500,
top_p: 0.5,
top_k: 1
})
});
DeepSeek v4 Pro Web Search
엔드포인트
POST /api/v1/chat/completions
요청 파라미터
필수
메시지 지원
선택 사항
요청 예시
const response = await fetch('https://api.flaq.ai/api/v1/chat/completions', {
method: 'POST',
headers: {
'Authorization': 'Bearer YOUR_API_KEY',
'Accept': 'text/event-stream',
'Content-Type': 'application/json'
},
body: JSON.stringify({
model: 'deepseek-v4-pro-web-search',
messages: [
{
role: 'user',
content: 'What date is it today?'
}
],
stream: true,
max_tokens: 500,
top_p: 0.5,
top_k: 1
})
});
DeepSeek v4 Flash Web Search
엔드포인트
POST /api/v1/chat/completions
요청 파라미터
필수
메시지 지원
선택 사항
요청 예시
const response = await fetch('https://api.flaq.ai/api/v1/chat/completions', {
method: 'POST',
headers: {
'Authorization': 'Bearer YOUR_API_KEY',
'Accept': 'text/event-stream',
'Content-Type': 'application/json'
},
body: JSON.stringify({
model: 'deepseek-v4-flash-web-search',
messages: [
{
role: 'user',
content: 'What date is it today?'
}
],
stream: true,
max_tokens: 500,
top_p: 0.5,
top_k: 1
})
});
응답 형식
DeepSeek V4 LLM 모델은 OpenAI 호환 completion 응답을 반환합니다. stream: true이면 응답은 Server-Sent Events(SSE)이며, stream: false이면 단일 JSON 객체입니다.
오류 응답
{
"error": {
"code": "1001",
"param": null,
"message": "Authorization is empty",
"type": "invalid_request_error"
}
}
모범 사례
- 올바른 변형 선택: 더 높은 품질의 추론에는 Pro 모델을, 낮은 지연 시간과 낮은 비용의 워크로드에는 Flash 모델을 사용하세요.
- 최신 이벤트에는 Web Search 사용: 답변이 최신 온라인 정보에 의존할 때 Pro 또는 Flash Web Search를 선택하세요.
- 샘플링 파라미터를 신중하게 조정:
top_p와 top_k는 모든 DeepSeek v4 변형에서 지원되며 출력 다양성을 바꿀 수 있습니다.
- 지원되는 입력만 전송: 어떤 DeepSeek v4 route에도 파일 또는 이미지 파트를 보내지 마세요.
- Accept를 stream 모드와 맞춤: 스트리밍 요청에는
Accept: text/event-stream을, 비스트리밍 요청에는 Accept: application/json을 사용하세요.