API Qwen 3.8 Max
Tài liệu tham khảo API đầy đủ cho các mô hình LLM Qwen 3.8 Max do Alibaba cung cấp.
Các biến thể mô hình
API này hỗ trợ hai biến thể mô hình Qwen 3.8 Max:
So sánh nhanh
Qwen 3.8 Max Văn bản sang văn bản
Điểm cuối
POST /api/v1/chat/completions
Tham số yêu cầu
Bắt buộc
Hỗ trợ thông điệp
Tùy chọn
Yêu cầu mẫu
const response = await fetch('https://api.flaq.ai/api/v1/chat/completions', {
method: 'POST',
headers: {
'Authorization': 'Bearer YOUR_API_KEY',
'Accept': 'text/event-stream',
'Content-Type': 'application/json'
},
body: JSON.stringify({
model: 'qwen-3.8-max-text-to-text',
messages: [
{
role: 'user',
content: 'Explain the concept of attention mechanisms in neural networks.'
}
],
stream: true,
max_tokens: 2048
})
});
Qwen 3.8 Max Tìm kiếm web
Điểm cuối
POST /api/v1/chat/completions
Tham số yêu cầu
Bắt buộc
Hỗ trợ thông điệp
Tùy chọn
Yêu cầu mẫu
const response = await fetch('https://api.flaq.ai/api/v1/chat/completions', {
method: 'POST',
headers: {
'Authorization': 'Bearer YOUR_API_KEY',
'Accept': 'text/event-stream',
'Content-Type': 'application/json'
},
body: JSON.stringify({
model: 'qwen-3.8-max-web-search',
messages: [
{
role: 'user',
content: 'What are the latest developments in quantum computing this year?'
}
],
stream: true,
max_tokens: 2048
})
});
Định dạng phản hồi
Các mô hình LLM Qwen 3.8 Max trả về phản hồi completion tương thích với OpenAI. Với stream: true, phản hồi là Server-Sent Events; với stream: false, phản hồi là một đối tượng JSON duy nhất.
Phản hồi thành công
data: {"id":"chatcmpl-...","object":"chat.completion.chunk","created":1710000000,"model":"qwen-3.8-max-text-to-text","choices":[{"index":0,"delta":{"role":"assistant"},"finish_reason":null}]}
data: {"id":"chatcmpl-...","object":"chat.completion.chunk","created":1710000000,"model":"qwen-3.8-max-text-to-text","choices":[{"index":0,"delta":{"content":"Here is a concise explanation"},"finish_reason":null}]}
data: {"id":"chatcmpl-...","object":"chat.completion.chunk","created":1710000000,"model":"qwen-3.8-max-text-to-text","choices":[{"index":0,"delta":{},"finish_reason":"stop"}]}
data: {"id":"chatcmpl-...","object":"chat.completion.chunk","created":1710000000,"model":"qwen-3.8-max-text-to-text","choices":[],"usage":{"prompt_tokens":12,"completion_tokens":8,"total_tokens":20}}
data: [DONE]
Phản hồi lỗi
event: error
data: {"error":{"message":"API requests too frequent, exceeding rate limit","type":"rate_limit_error","code":"1302","param":null}}
Các phương pháp hay nhất
- Sử dụng thông điệp có cấu trúc: Gửi lịch sử hội thoại qua
messages[] thay vì dồn toàn bộ ngữ cảnh vào một lời nhắc.
- Chọn đúng biến thể: Sử dụng Text to Text cho các tác vụ suy luận và tạo nội dung. Sử dụng Web Search khi cần thông tin cập nhật.
- Xử lý sự kiện SSE: Nối thêm
choices[0].delta.content để hiển thị truyền phát và coi data: [DONE] là hoàn tất thành công.
- Chỉ gửi đầu vào được hỗ trợ: Các mô hình Qwen 3.8 Max chỉ hỗ trợ văn bản và không hỗ trợ tệp đính kèm hoặc hình ảnh.