API Qwen Character
Referência completa da API para modelos de roleplay Qwen Character da Alibaba. Os modelos Qwen Character usam o endpoint de chat completions da Flaq AI, mas também oferecem suporte a campos específicos de personagem para memória de longo prazo, simulação de chat em grupo e continuação parcial do assistant.
Variantes do modelo
Esta API oferece suporte a duas variantes de modelo:
Comparação rápida
Como funciona o roleplay de personagens
Use mensagens normais system, user e assistant para roleplay com um único personagem. Coloque instruções estáveis de persona em uma mensagem system para a solicitação atual. Quando a memória de longo prazo estiver habilitada, coloque o perfil reutilizável do personagem em profile.
Para simulação de chat em grupo, Qwen Character não infere automaticamente os nomes dos falantes a partir de profile. O chamador deve escrever os nomes dos falantes no início de cada content de mensagem, como Cheng Yi: ou Ling Lu:. Para fazer o modelo continuar como um personagem específico, adicione uma mensagem final de assistant cujo content seja o prefixo do falante de destino e defina partial: true.
partial é um campo no nível da mensagem na mensagem final de assistant. Ele não é um parâmetro de solicitação de nível superior.
Qwen Plus Character
Ponto de conexão
http
Parâmetros da solicitação
Obrigatórios
Cabeçalhos
Suporte a mensagens
Campos de mensagem
Opcionais
Quando a memória de longo prazo está habilitada, você deve fornecer:
- Cabeçalho de solicitação
x-session profileno corpo da solicitaçãoenable_long_term_memory: true
skip_save_types oferece suporte a estes valores:
Solicitação básica de roleplay
javascript
Solicitação com memória de longo prazo
javascript
Simulação de chat em grupo com partial
A simulação de chat em grupo é implementada por meio do texto das mensagens. A API não atribui nem migra automaticamente nomes de falantes. Escreva cada nome de falante manualmente no início de content e depois adicione uma mensagem final de assistant com o prefixo do falante de destino e partial: true.
javascript
Continuar como personagem com partial
Use o mesmo padrão de partial quando o usuário não tiver respondido, mas você quiser que o personagem continue falando. Adicione uma mensagem final de assistant com o prefixo do personagem.
javascript
Qwen Flash Character
Parâmetros da solicitação
Mesmo protocolo que Qwen Plus Character, com estas diferenças:
Solicitação de exemplo
javascript
Formato da resposta
Os modelos LLM Qwen Character retornam respostas de conclusão compatíveis com a OpenAI. Com stream: true, a resposta é transmitida por eventos enviados pelo servidor (SSE); com stream: false, ela é retornada como um único objeto JSON.
Boas práticas
- Coloque instruções de persona no nível da solicitação em mensagens
system. - Coloque o histórico reutilizável do personagem em
profilesomente quando a memória de longo prazo estiver habilitada. - Reutilize o mesmo valor de
x-sessionem conversas relacionadas quando a memória de longo prazo estiver habilitada. Sessões sem uso por 365 dias podem ser apagadas. - Continue enviando mensagens recentes da conversa quando for útil; memória de longo prazo e contexto de curto prazo podem funcionar juntos.
- Para simulação de chat em grupo, escreva manualmente os nomes dos falantes em
content. A API não inferirá nomes deprofile. - Use
partial: truesomente na mensagem final de assistant quando o modelo deve continuar a partir de um prefixo. - Use Qwen Flash Character para roleplay leve e Qwen Plus Character para qualidade de diálogo mais rica.