Claude Opus 5 API
由 Anthropic 提供支持的 Claude Opus 5 LLM 模型完整 API 参考。
模型变体
此 API 支持两种 Claude Opus 5 模型变体:
快速比较
Claude Opus 5 文本生成文本
端点
POST /api/v1/chat/completions
请求参数
必需
消息支持
可选
请求示例
const response = await fetch('https://api.flaq.ai/api/v1/chat/completions', {
method: 'POST',
headers: {
'Authorization': 'Bearer YOUR_API_KEY',
'Accept': 'text/event-stream',
'Content-Type': 'application/json'
},
body: JSON.stringify({
model: 'claude-opus-5-text-to-text',
messages: [
{
role: 'user',
content: '为此架构选择起草一份技术决策备忘录。'
}
],
stream: true,
max_tokens: 2048
})
});
Claude Opus 5 文件分析
端点
POST /api/v1/chat/completions
请求参数
必需
消息支持
可选
请求示例
const response = await fetch('https://api.flaq.ai/api/v1/chat/completions', {
method: 'POST',
headers: {
'Authorization': 'Bearer YOUR_API_KEY',
'Accept': 'text/event-stream',
'Content-Type': 'application/json'
},
body: JSON.stringify({
model: 'claude-opus-5-file-analysis',
messages: [
{
role: 'user',
content: [
{ type: 'text', text: '总结此文件并提取主要风险。' },
{
type: 'file',
file: {
filename: 'demo.pdf',
file_data: 'https://example.com/demo.pdf'
}
}
]
}
],
stream: true,
max_tokens: 4096
})
});
响应格式
Claude Opus 5 LLM 模型返回与 OpenAI 兼容的补全响应。当 stream: true 时,响应为 Server-Sent Events;当 stream: false 时,响应为单个 JSON 对象。
成功响应
data: {"id":"chatcmpl-...","object":"chat.completion.chunk","created":1710000000,"model":"claude-opus-5-file-analysis","choices":[{"index":0,"delta":{"role":"assistant"},"finish_reason":null}]}
data: {"id":"chatcmpl-...","object":"chat.completion.chunk","created":1710000000,"model":"claude-opus-5-file-analysis","choices":[{"index":0,"delta":{"content":"以下是简明摘要"},"finish_reason":null}]}
data: {"id":"chatcmpl-...","object":"chat.completion.chunk","created":1710000000,"model":"claude-opus-5-file-analysis","choices":[{"index":0,"delta":{},"finish_reason":"stop"}]}
data: {"id":"chatcmpl-...","object":"chat.completion.chunk","created":1710000000,"model":"claude-opus-5-file-analysis","choices":[],"usage":{"prompt_tokens":12,"completion_tokens":8,"total_tokens":20}}
data: [DONE]
错误响应
event: error
data: {"error":{"message":"API 请求过于频繁,超出速率限制","type":"rate_limit_error","code":"1302","param":null}}
最佳实践
- 使用结构化消息: 通过
messages[] 发送对话历史,而不是将上下文合并到一个 prompt 中。
- 选择正确的模型变体: 纯文本推理和写作使用文本生成文本,需要文件或图像时使用文件分析。
- 处理 SSE 事件: 追加
choices[0].delta.content 以进行流式显示,并将 data: [DONE] 视为成功完成。
- 仅发送支持的输入: 当前客户端中的文本模型会忽略不支持的文件和图像部分。