Qwen 3.8 Max API
Alibaba が提供する Qwen 3.8 Max LLM モデルの完全な API リファレンスです。
モデルバリエーション {#}
この API は、Qwen 3.8 Max の 2 つのモデルバリエーションをサポートしています。
クイック比較
Qwen 3.8 Max Text to Text
エンドポイント
POST /api/v1/chat/completions
リクエストパラメータ
必須
メッセージのサポート
任意
リクエスト例
const response = await fetch('https://api.flaq.ai/api/v1/chat/completions', {
method: 'POST',
headers: {
'Authorization': 'Bearer YOUR_API_KEY',
'Accept': 'text/event-stream',
'Content-Type': 'application/json'
},
body: JSON.stringify({
model: 'qwen-3.8-max-text-to-text',
messages: [
{
role: 'user',
content: 'Explain the concept of attention mechanisms in neural networks.'
}
],
stream: true,
max_tokens: 2048
})
});
Qwen 3.8 Max Web Search
エンドポイント
POST /api/v1/chat/completions
リクエストパラメータ
必須
メッセージのサポート
任意
リクエスト例
const response = await fetch('https://api.flaq.ai/api/v1/chat/completions', {
method: 'POST',
headers: {
'Authorization': 'Bearer YOUR_API_KEY',
'Accept': 'text/event-stream',
'Content-Type': 'application/json'
},
body: JSON.stringify({
model: 'qwen-3.8-max-web-search',
messages: [
{
role: 'user',
content: 'What are the latest developments in quantum computing this year?'
}
],
stream: true,
max_tokens: 2048
})
});
レスポンス形式
Qwen 3.8 Max LLM モデルは、OpenAI 互換の補完レスポンスを返します。stream: true の場合、レスポンスは Server-Sent Events となり、stream: false の場合は単一の JSON オブジェクトとなります。
成功レスポンス
data: {"id":"chatcmpl-...","object":"chat.completion.chunk","created":1710000000,"model":"qwen-3.8-max-text-to-text","choices":[{"index":0,"delta":{"role":"assistant"},"finish_reason":null}]}
data: {"id":"chatcmpl-...","object":"chat.completion.chunk","created":1710000000,"model":"qwen-3.8-max-text-to-text","choices":[{"index":0,"delta":{"content":"Here is a concise explanation"},"finish_reason":null}]}
data: {"id":"chatcmpl-...","object":"chat.completion.chunk","created":1710000000,"model":"qwen-3.8-max-text-to-text","choices":[{"index":0,"delta":{},"finish_reason":"stop"}]}
data: {"id":"chatcmpl-...","object":"chat.completion.chunk","created":1710000000,"model":"qwen-3.8-max-text-to-text","choices":[],"usage":{"prompt_tokens":12,"completion_tokens":8,"total_tokens":20}}
data: [DONE]
エラーレスポンス
event: error
data: {"error":{"message":"API requests too frequent, exceeding rate limit","type":"rate_limit_error","code":"1302","param":null}}
ベストプラクティス
- 構造化されたメッセージを使用する: コンテキストを 1 つのプロンプトにまとめるのではなく、
messages[] を通じて会話履歴を送信します。
- 適切なバリエーションを選択する: 推論や生成タスクには Text to Text を使用します。最新情報が必要な場合は Web Search を使用します。
- SSE イベントを処理する: ストリーミング表示には
choices[0].delta.content を追加し、data: [DONE] を正常完了として扱います。
- サポートされる入力のみを送信する: Qwen 3.8 Max モデルはテキスト専用であり、ファイルや画像の添付には対応していません。