API Qwen Character
Référence complète de l'API pour les modèles de roleplay Qwen Character d'Alibaba. Les modèles Qwen Character utilisent l'endpoint chat completions de Flaq AI, mais ils prennent aussi en charge des champs propres aux personnages pour la mémoire à long terme, la simulation de chat de groupe et la continuation partielle de l'assistant.
Variantes du modèle
Cette API prend en charge deux variantes de modèle :
Comparaison rapide
Fonctionnement du roleplay de personnages
Utilisez les messages normaux system, user et assistant pour le roleplay avec un seul personnage. Placez les instructions de persona stables dans un message system pour la requête actuelle. Lorsque la mémoire à long terme est activée, placez le profil de personnage réutilisable dans profile.
Pour la simulation de chat de groupe, Qwen Character ne déduit pas automatiquement les noms des locuteurs depuis profile. L'appelant doit écrire les noms des locuteurs au début de chaque content de message, par exemple Cheng Yi: ou Ling Lu:. Pour faire continuer le modèle en tant qu'un personnage précis, ajoutez un dernier message assistant dont le content est le préfixe du locuteur cible et définissez partial: true.
partial est un champ au niveau du message sur le dernier message assistant. Ce n'est pas un paramètre de requête de niveau supérieur.
Qwen Plus Character
Point de terminaison
http
Paramètres de requête
Obligatoires
En-têtes
Prise en charge des messages
Champs de message
Facultatifs
Lorsque la mémoire à long terme est activée, vous devez fournir :
- En-tête de requête
x-session profiledans le corps de la requêteenable_long_term_memory: true
skip_save_types prend en charge ces valeurs :
Requête de roleplay de base
javascript
Requête avec mémoire à long terme
javascript
Simulation de chat de groupe avec partial
La simulation de chat de groupe est implémentée par le texte des messages. L'API n'attribue ni ne migre automatiquement les noms des locuteurs. Écrivez chaque nom de locuteur manuellement au début de content, puis ajoutez un dernier message assistant avec le préfixe du locuteur cible et partial: true.
javascript
Continuer en tant que personnage avec partial
Utilisez le même modèle partial lorsque l'utilisateur n'a pas répondu mais que vous souhaitez que le personnage continue à parler. Ajoutez un dernier message assistant avec le préfixe du personnage.
javascript
Qwen Flash Character
Paramètres de requête
Même protocole que Qwen Plus Character, avec ces différences :
Exemple de requête
javascript
Format de réponse
Les modèles LLM Qwen Character renvoient des réponses de complétion compatibles avec OpenAI. Avec stream: true, la réponse est transmise sous forme d’événements envoyés par le serveur (SSE) ; avec stream: false, elle prend la forme d’un objet JSON unique.
Bonnes pratiques
- Placez les instructions de persona au niveau de la requête dans les messages
system. - Placez l'arrière-plan réutilisable du personnage dans
profileuniquement lorsque la mémoire à long terme est activée. - Réutilisez la même valeur
x-sessiondans les conversations liées lorsque la mémoire à long terme est activée. Les sessions inutilisées pendant 365 jours peuvent être supprimées. - Continuez à envoyer les messages récents de la conversation lorsque c'est utile ; la mémoire à long terme et le contexte à court terme peuvent fonctionner ensemble.
- Pour la simulation de chat de groupe, écrivez manuellement les noms des locuteurs dans
content. L'API ne déduira pas les noms depuisprofile. - Utilisez
partial: trueuniquement sur le dernier message assistant lorsque le modèle doit continuer à partir d'un préfixe. - Utilisez Qwen Flash Character pour le roleplay léger et Qwen Plus Character pour une qualité de dialogue plus riche.