API de Qwen Character
Referencia completa de la API para los modelos de roleplay Qwen Character de Alibaba. Los modelos Qwen Character usan el endpoint de chat completions de Flaq AI, pero también admiten campos específicos de personaje para memoria a largo plazo, simulación de chat grupal y continuación parcial del asistente.
Variantes del modelo
Esta API admite dos variantes de modelo:
Comparación rápida
Cómo funciona el roleplay de personajes
Usa mensajes normales system, user y assistant para el roleplay de un solo personaje. Coloca las instrucciones estables de persona en un mensaje system para la solicitud actual. Cuando la memoria a largo plazo esté habilitada, coloca el perfil reutilizable del personaje en profile.
Para la simulación de chat grupal, Qwen Character no infiere automáticamente los nombres de los hablantes desde profile. El llamador debe escribir los nombres de los hablantes al comienzo de cada content de mensaje, como Cheng Yi: o Ling Lu:. Para hacer que el modelo continúe como un personaje específico, agrega un mensaje final de asistente cuyo content sea el prefijo del hablante objetivo y establece partial: true.
partial es un campo de nivel de mensaje en el mensaje final de asistente. No es un parámetro de solicitud de nivel superior.
Qwen Plus Character
Punto de conexión
http
Parámetros de solicitud
Obligatorios
Encabezados
Compatibilidad de mensajes
Campos de mensaje
Opcionales
Cuando la memoria a largo plazo está habilitada, debes proporcionar:
- Encabezado de solicitud
x-session profileen el cuerpo de la solicitudenable_long_term_memory: true
skip_save_types admite estos valores:
Solicitud básica de roleplay
javascript
Solicitud con memoria a largo plazo
javascript
Simulación de chat grupal con partial
La simulación de chat grupal se implementa mediante el texto de los mensajes. La API no asigna ni migra automáticamente nombres de hablantes. Escribe cada nombre de hablante manualmente al inicio de content y luego agrega un mensaje final de asistente con el prefijo del hablante objetivo y partial: true.
javascript
Continuar como personaje con partial
Usa el mismo patrón de partial cuando el usuario no haya respondido pero quieras que el personaje siga hablando. Agrega un mensaje final de asistente con el prefijo del personaje.
javascript
Qwen Flash Character
Parámetros de solicitud
El mismo protocolo que Qwen Plus Character, con estas diferencias:
Solicitud de ejemplo
javascript
Formato de respuesta
Los modelos LLM Qwen Character devuelven respuestas de finalización compatibles con OpenAI. Con stream: true, la respuesta se transmite mediante eventos enviados por el servidor (SSE); con stream: false, se devuelve como un único objeto JSON.
Buenas prácticas
- Coloca las instrucciones de persona de nivel de solicitud en mensajes
system. - Coloca el trasfondo reutilizable del personaje en
profilesolo cuando la memoria a largo plazo esté habilitada. - Reutiliza el mismo valor de
x-sessionen conversaciones relacionadas cuando la memoria a largo plazo esté habilitada. Las sesiones sin uso durante 365 días pueden borrarse. - Sigue enviando mensajes recientes de la conversación cuando sea útil; la memoria a largo plazo y el contexto a corto plazo pueden funcionar juntos.
- Para la simulación de chat grupal, escribe manualmente los nombres de los hablantes en
content. La API no inferirá nombres desdeprofile. - Usa
partial: truesolo en el mensaje final de asistente cuando el modelo deba continuar desde un prefijo. - Usa Qwen Flash Character para roleplay ligero y Qwen Plus Character para una calidad de diálogo más rica.