Qwen 3.8 Max API
เอกสารอ้างอิง API ฉบับสมบูรณ์สำหรับโมเดล LLM Qwen 3.8 Max ที่ขับเคลื่อนโดย Alibaba
รุ่นโมเดล {#}
API นี้รองรับโมเดล Qwen 3.8 Max สองรุ่น:
การเปรียบเทียบแบบย่อ
Qwen 3.8 Max ข้อความเป็นข้อความ
จุดเชื่อมต่อ API
POST /api/v1/chat/completions
พารามิเตอร์คำขอ
จำเป็น
การรองรับข้อความ
ไม่บังคับ
ตัวอย่างคำขอ
const response = await fetch('https://api.flaq.ai/api/v1/chat/completions', {
method: 'POST',
headers: {
'Authorization': 'Bearer YOUR_API_KEY',
'Accept': 'text/event-stream',
'Content-Type': 'application/json'
},
body: JSON.stringify({
model: 'qwen-3.8-max-text-to-text',
messages: [
{
role: 'user',
content: 'Explain the concept of attention mechanisms in neural networks.'
}
],
stream: true,
max_tokens: 2048
})
});
Qwen 3.8 Max การค้นหาเว็บ
จุดเชื่อมต่อ API
POST /api/v1/chat/completions
พารามิเตอร์คำขอ
จำเป็น
การรองรับข้อความ
ไม่บังคับ
ตัวอย่างคำขอ
const response = await fetch('https://api.flaq.ai/api/v1/chat/completions', {
method: 'POST',
headers: {
'Authorization': 'Bearer YOUR_API_KEY',
'Accept': 'text/event-stream',
'Content-Type': 'application/json'
},
body: JSON.stringify({
model: 'qwen-3.8-max-web-search',
messages: [
{
role: 'user',
content: 'What are the latest developments in quantum computing this year?'
}
],
stream: true,
max_tokens: 2048
})
});
รูปแบบการตอบกลับ
โมเดล LLM Qwen 3.8 Max ส่งคืนการตอบกลับ completion ที่เข้ากันได้กับ OpenAI เมื่อใช้ stream: true การตอบกลับจะเป็น Server-Sent Events และเมื่อใช้ stream: false การตอบกลับจะเป็นออบเจ็กต์ JSON รายการเดียว
การตอบกลับสำเร็จ
data: {"id":"chatcmpl-...","object":"chat.completion.chunk","created":1710000000,"model":"qwen-3.8-max-text-to-text","choices":[{"index":0,"delta":{"role":"assistant"},"finish_reason":null}]}
data: {"id":"chatcmpl-...","object":"chat.completion.chunk","created":1710000000,"model":"qwen-3.8-max-text-to-text","choices":[{"index":0,"delta":{"content":"Here is a concise explanation"},"finish_reason":null}]}
data: {"id":"chatcmpl-...","object":"chat.completion.chunk","created":1710000000,"model":"qwen-3.8-max-text-to-text","choices":[{"index":0,"delta":{},"finish_reason":"stop"}]}
data: {"id":"chatcmpl-...","object":"chat.completion.chunk","created":1710000000,"model":"qwen-3.8-max-text-to-text","choices":[],"usage":{"prompt_tokens":12,"completion_tokens":8,"total_tokens":20}}
data: [DONE]
การตอบกลับข้อผิดพลาด
event: error
data: {"error":{"message":"API requests too frequent, exceeding rate limit","type":"rate_limit_error","code":"1302","param":null}}
แนวทางปฏิบัติที่แนะนำ
- ใช้ข้อความที่มีโครงสร้าง: ส่งประวัติการสนทนาผ่าน
messages[] แทนการรวมบริบททั้งหมดไว้ในพรอมต์เดียว
- เลือกรุ่นที่เหมาะสม: ใช้ Text to Text สำหรับงานการใช้เหตุผลและการสร้างเนื้อหา ใช้ Web Search เมื่อต้องการข้อมูลล่าสุด
- ประมวลผลเหตุการณ์ SSE: เพิ่ม
choices[0].delta.content ต่อท้ายสำหรับการแสดงผลแบบสตรีม และถือว่า data: [DONE] คือการดำเนินการเสร็จสมบูรณ์
- ส่งเฉพาะอินพุตที่รองรับ: โมเดล Qwen 3.8 Max รองรับเฉพาะข้อความและไม่รองรับไฟล์แนบหรือรูปภาพ