DeepSeek v4 API
DeepSeek v4 LLM 模型的完整 API 参考,由 DeepSeek 提供支持。
模型更新
DeepSeek v4 Flash 0731
- Flaq AI 已将 DeepSeek v4 Flash 更新至 DeepSeek 官方发布的
deepseek-v4-flash-0731 版本。
- 使用下方的
0731 模型 ID 访问更新后的版本。
- 原始模型 ID 仍可用于现有 API 集成。
模型变体
此 API 支持四种 DeepSeek v4 模型变体:
快速对比
DeepSeek v4 Pro Text to Text
端点
POST /api/v1/chat/completions
请求参数
必需
消息支持
可选
示例请求
const response = await fetch('https://api.flaq.ai/api/v1/chat/completions', {
method: 'POST',
headers: {
'Authorization': 'Bearer YOUR_API_KEY',
'Accept': 'text/event-stream',
'Content-Type': 'application/json'
},
body: JSON.stringify({
model: 'deepseek-v4-pro-text-to-text',
messages: [
{
role: 'user',
content: 'Hello'
}
],
stream: true,
max_tokens: 500,
top_p: 0.5,
top_k: 1
})
});
DeepSeek v4 Flash Text to Text
端点
POST /api/v1/chat/completions
请求参数
必需
消息支持
可选
示例请求
const response = await fetch('https://api.flaq.ai/api/v1/chat/completions', {
method: 'POST',
headers: {
'Authorization': 'Bearer YOUR_API_KEY',
'Accept': 'application/json',
'Content-Type': 'application/json'
},
body: JSON.stringify({
model: 'deepseek-v4-flash-text-to-text',
messages: [
{
role: 'user',
content: 'Write a four-line modern poem about a programmer drinking coffee.'
}
],
stream: false,
max_tokens: 500,
top_p: 0.5,
top_k: 1
})
});
DeepSeek v4 Pro Web Search
端点
POST /api/v1/chat/completions
请求参数
必需
消息支持
可选
示例请求
const response = await fetch('https://api.flaq.ai/api/v1/chat/completions', {
method: 'POST',
headers: {
'Authorization': 'Bearer YOUR_API_KEY',
'Accept': 'text/event-stream',
'Content-Type': 'application/json'
},
body: JSON.stringify({
model: 'deepseek-v4-pro-web-search',
messages: [
{
role: 'user',
content: 'What date is it today?'
}
],
stream: true,
max_tokens: 500,
top_p: 0.5,
top_k: 1
})
});
DeepSeek v4 Flash Web Search
端点
POST /api/v1/chat/completions
请求参数
必需
消息支持
可选
示例请求
const response = await fetch('https://api.flaq.ai/api/v1/chat/completions', {
method: 'POST',
headers: {
'Authorization': 'Bearer YOUR_API_KEY',
'Accept': 'text/event-stream',
'Content-Type': 'application/json'
},
body: JSON.stringify({
model: 'deepseek-v4-flash-web-search',
messages: [
{
role: 'user',
content: 'What date is it today?'
}
],
stream: true,
max_tokens: 500,
top_p: 0.5,
top_k: 1
})
});
响应格式
DeepSeek V4 LLM 模型返回与 OpenAI 兼容的补全响应。使用 stream: true 时,响应为服务器发送事件(SSE);使用 stream: false 时,响应为单个 JSON 对象。
错误响应
{
"error": {
"code": "1001",
"param": null,
"message": "Authorization is empty",
"type": "invalid_request_error"
}
}
最佳实践
- 选择合适的变体: 对更高质量推理使用 Pro 模型;对低延迟、低成本工作负载使用 Flash 模型。
- 针对时事使用 Web Search: 当答案依赖最新在线信息时,选择 Pro 或 Flash Web Search。
- 谨慎调整采样参数:
top_p 和 top_k 在所有 DeepSeek v4 变体中均受支持,并会改变输出多样性。
- 仅发送受支持的输入: 不要向任何 DeepSeek v4 route 发送文件或图片部分。
- 让 Accept 与 stream 模式匹配: 流式请求使用
Accept: text/event-stream,非流式请求使用 Accept: application/json。