API de Claude Sonnet 4.6
Referencia completa de la API para los modelos modelos de lenguaje Claude Sonnet 4.6 impulsados por Anthropic.
Variantes del modelo
Esta API admite dos variantes del modelo Claude Sonnet 4.6:
Comparación rápida
Claude Sonnet 4.6 Text to Text
Punto de conexión
POST /api/v1/chat/completions
Parámetros de solicitud
Obligatorio
Compatibilidad de mensajes
Opcional
Solicitud de ejemplo
const response = await fetch('https://api.flaq.ai/api/v1/chat/completions', {
method: 'POST',
headers: {
'Authorization': 'Bearer YOUR_API_KEY',
'Accept': 'text/event-stream',
'Content-Type': 'application/json'
},
body: JSON.stringify({
model: 'claude-sonnet-4.6-text-to-text',
messages: [
{
role: 'user',
content: 'Write a concise product update for a developer audience.'
}
],
stream: true,
max_tokens: 2048,
top_p: 0.5,
top_k: 50
})
});
Claude Sonnet 4.6 File Analysis
Punto de conexión
POST /api/v1/chat/completions
Parámetros de solicitud
Obligatorio
Compatibilidad de mensajes
Opcional
Solicitud de ejemplo
const response = await fetch('https://api.flaq.ai/api/v1/chat/completions', {
method: 'POST',
headers: {
'Authorization': 'Bearer YOUR_API_KEY',
'Accept': 'text/event-stream',
'Content-Type': 'application/json'
},
body: JSON.stringify({
model: 'claude-sonnet-4.6-file-analysis',
messages: [
{
role: 'user',
content: [
{ type: 'text', text: 'Summarize this file and extract the key risks.' },
{
type: 'file',
file: {
filename: 'demo.pdf',
file_data: 'https://example.com/demo.pdf'
}
}
]
}
],
stream: true,
max_tokens: 4096,
top_p: 0.5,
top_k: 50
})
});
Los modelos LLM Claude Sonnet 4.6 devuelven respuestas de completion compatibles con OpenAI. Con stream: true, la respuesta es Server-Sent Events; con stream: false, la respuesta es un único objeto JSON.
Respuesta correcta
data: {"id":"chatcmpl-...","object":"chat.completion.chunk","created":1710000000,"model":"claude-sonnet-4.6-file-analysis","choices":[{"index":0,"delta":{"role":"assistant"},"finish_reason":null}]}
data: {"id":"chatcmpl-...","object":"chat.completion.chunk","created":1710000000,"model":"claude-sonnet-4.6-file-analysis","choices":[{"index":0,"delta":{"content":"Here is a concise summary"},"finish_reason":null}]}
data: {"id":"chatcmpl-...","object":"chat.completion.chunk","created":1710000000,"model":"claude-sonnet-4.6-file-analysis","choices":[{"index":0,"delta":{},"finish_reason":"stop"}]}
data: {"id":"chatcmpl-...","object":"chat.completion.chunk","created":1710000000,"model":"claude-sonnet-4.6-file-analysis","choices":[],"usage":{"prompt_tokens":12,"completion_tokens":8,"total_tokens":20}}
data: [DONE]
Respuesta de error
event: error
data: {"error":{"message":"API requests too frequent, exceeding rate limit","type":"rate_limit_error","code":"1302","param":null}}
Buenas prácticas
- Usa mensajes estructurados: Envía el historial de conversación mediante
messages[] en lugar de aplanar el contexto en un único prompt.
- Elige la variante de modelo correcta: Usa Text to Text para razonamiento y escritura solo de texto y File Analysis cuando se necesiten archivos o imágenes.
- Ajusta cuidadosamente los parámetros de Claude:
top_p y top_k son compatibles y pueden cambiar la diversidad de salida.
- Consume eventos SSE: Añade
choices[0].delta.content para la visualización en streaming y usa data: [DONE] como respuesta final.
- Envía solo entradas compatibles: Los modelos de texto ignoran las partes de archivo e imagen no compatibles en el cliente actual.