Qwen 3.7 API
Référence API complète pour les modèles LLM Qwen 3.7 fournis par Alibaba.
Variantes de modèle
Cette API prend en charge quatre variantes du modèle Qwen 3.7 :
Comparaison rapide
Qwen 3.7 Max Text to Text
Point de terminaison
POST /api/v1/chat/completions
Paramètres de requête
Obligatoire
Prise en charge des messages
Facultatif
Exemple de requête
const response = await fetch('https://api.flaq.ai/api/v1/chat/completions', {
method: 'POST',
headers: {
'Authorization': 'Bearer YOUR_API_KEY',
'Accept': 'text/event-stream',
'Content-Type': 'application/json'
},
body: JSON.stringify({
model: 'qwen-3.7-max-text-to-text',
messages: [
{
role: 'user',
content: 'Explain the concept of attention mechanisms in neural networks.'
}
],
stream: true,
max_tokens: 2048
})
});
Qwen 3.7 Plus Text to Text
Point de terminaison
POST /api/v1/chat/completions
Paramètres de requête
Obligatoire
Prise en charge des messages
Facultatif
Exemple de requête
const response = await fetch('https://api.flaq.ai/api/v1/chat/completions', {
method: 'POST',
headers: {
'Authorization': 'Bearer YOUR_API_KEY',
'Accept': 'text/event-stream',
'Content-Type': 'application/json'
},
body: JSON.stringify({
model: 'qwen-3.7-plus-text-to-text',
messages: [
{
role: 'user',
content: 'Explain the concept of attention mechanisms in neural networks.'
}
],
stream: true,
max_tokens: 2048
})
});
Qwen 3.7 Max Web Search
Point de terminaison
POST /api/v1/chat/completions
Paramètres de requête
Obligatoire
Prise en charge des messages
Facultatif
Exemple de requête
const response = await fetch('https://api.flaq.ai/api/v1/chat/completions', {
method: 'POST',
headers: {
'Authorization': 'Bearer YOUR_API_KEY',
'Accept': 'text/event-stream',
'Content-Type': 'application/json'
},
body: JSON.stringify({
model: 'qwen-3.7-max-web-search',
messages: [
{
role: 'user',
content: 'What are the latest developments in quantum computing this year?'
}
],
stream: true,
max_tokens: 2048
})
});
Qwen 3.7 Plus Web Search
Point de terminaison
POST /api/v1/chat/completions
Paramètres de requête
Obligatoire
Prise en charge des messages
Facultatif
Exemple de requête
const response = await fetch('https://api.flaq.ai/api/v1/chat/completions', {
method: 'POST',
headers: {
'Authorization': 'Bearer YOUR_API_KEY',
'Accept': 'text/event-stream',
'Content-Type': 'application/json'
},
body: JSON.stringify({
model: 'qwen-3.7-plus-web-search',
messages: [
{
role: 'user',
content: 'What are the latest developments in quantum computing this year?'
}
],
stream: true,
max_tokens: 2048
})
});
Qwen 3.7 LLM models return OpenAI-compatible completion responses. With stream: true, the response is Server-Sent Events; with stream: false, the response is a single JSON object.
Réponse réussie
data: {"id":"chatcmpl-...","object":"chat.completion.chunk","created":1710000000,"model":"qwen-3.7-max-text-to-text","choices":[{"index":0,"delta":{"role":"assistant"},"finish_reason":null}]}
data: {"id":"chatcmpl-...","object":"chat.completion.chunk","created":1710000000,"model":"qwen-3.7-max-text-to-text","choices":[{"index":0,"delta":{"content":"Here is a concise explanation"},"finish_reason":null}]}
data: {"id":"chatcmpl-...","object":"chat.completion.chunk","created":1710000000,"model":"qwen-3.7-max-text-to-text","choices":[{"index":0,"delta":{},"finish_reason":"stop"}]}
data: {"id":"chatcmpl-...","object":"chat.completion.chunk","created":1710000000,"model":"qwen-3.7-max-text-to-text","choices":[],"usage":{"prompt_tokens":12,"completion_tokens":8,"total_tokens":20}}
data: [DONE]
Réponse d’erreur
event: error
data: {"error":{"message":"API requests too frequent, exceeding rate limit","type":"rate_limit_error","code":"1302","param":null}}
Bonnes pratiques
- Utiliser des messages structurés : Envoyez l’historique de conversation via
messages[] au lieu d’aplatir le contexte dans un seul prompt.
- Choisir la bonne variante : Utilisez Max pour les tâches de raisonnement complexes et Plus pour des réponses rapides et économiques. Utilisez les variantes Web Search lorsque des informations à jour sont nécessaires.
- Consommer les événements SSE : Ajoutez
choices[0].delta.content pour l’affichage en streaming et traitez data: [DONE] comme une fin réussie.
- Envoyer uniquement les entrées prises en charge : Les modèles Qwen 3.7 sont uniquement textuels et ne prennent pas en charge les fichiers ou images joints.