Qwen Character API
Vollständige API-Referenz für Qwen Character Rollenspielmodelle von Alibaba. Qwen Character Modelle verwenden den Chat-Completions-Endpunkt von Flaq AI, unterstützen aber zusätzlich charakterspezifische Felder für Langzeitgedächtnis, Gruppenchat-Simulation und partielle Assistant-Fortsetzung.
Modellvarianten
Diese API unterstützt zwei Modellvarianten:
Schneller Vergleich
Funktionsweise des Charakter-Rollenspiels
Verwenden Sie normale system-, user- und assistant-Nachrichten für Rollenspiele mit einem einzelnen Charakter. Legen Sie stabile Persona-Anweisungen für die aktuelle Anfrage in einer system-Nachricht ab. Wenn Langzeitgedächtnis aktiviert ist, legen Sie das wiederverwendbare Charakterprofil in profile ab.
Für die Gruppenchat-Simulation leitet Qwen Character Sprechernamen nicht automatisch aus profile ab. Der Aufrufer muss Sprechernamen am Anfang jedes Nachrichten-content schreiben, etwa Cheng Yi: oder Ling Lu:. Damit das Modell als bestimmter Charakter fortfährt, hängen Sie eine abschließende Assistant-Nachricht an, deren content das Zielsprecher-Präfix ist, und setzen Sie partial: true.
partial ist ein Feld auf Nachrichtenebene in der abschließenden Assistant-Nachricht. Es ist kein Anfrageparameter auf oberster Ebene.
Qwen Plus Character
Endpunkt
http
Anfrageparameter
Erforderlich
Header
Nachrichtenunterstützung
Nachrichtenfelder
Optionale Angaben
Wenn Langzeitgedächtnis aktiviert ist, müssen Sie Folgendes angeben:
x-session-Anfrageheaderprofileim Anfragebodyenable_long_term_memory: true
skip_save_types unterstützt diese Werte:
Einfache Rollenspielanfrage
javascript
Anfrage mit Langzeitgedächtnis
javascript
Gruppenchat-Simulation mit partial
Die Gruppenchat-Simulation wird über Nachrichtentext umgesetzt. Die API weist Sprechernamen nicht automatisch zu und migriert sie nicht automatisch. Schreiben Sie jeden Sprechernamen manuell an den Anfang von content und hängen Sie anschließend eine abschließende Assistant-Nachricht mit dem Zielsprecher-Präfix und partial: true an.
javascript
Als Charakter mit partial fortfahren
Verwenden Sie dasselbe partial-Muster, wenn der Benutzer noch nicht geantwortet hat, der Charakter aber weiter sprechen soll. Fügen Sie eine abschließende Assistant-Nachricht mit dem Charakterpräfix hinzu.
javascript
Qwen Flash Character
Anfrageparameter
Gleiches Protokoll wie Qwen Plus Character, mit diesen Unterschieden:
Beispielanfrage
javascript
Antwortformat
Die Qwen Character LLM-Modelle geben OpenAI-kompatible Completion-Antworten zurück. Bei stream: true wird die Antwort als Server-Sent Events übertragen; bei stream: false als einzelnes JSON-Objekt.
Bewährte Praktiken
- Platzieren Sie Persona-Anweisungen auf Anfrageebene in
system-Nachrichten. - Legen Sie wiederverwendbaren Charakterhintergrund nur dann in
profileab, wenn Langzeitgedächtnis aktiviert ist. - Verwenden Sie denselben
x-session-Wert über zusammengehörige Gespräche hinweg, wenn Langzeitgedächtnis aktiviert ist. Sitzungen, die 365 Tage nicht verwendet werden, können gelöscht werden. - Senden Sie weiterhin aktuelle Gesprächsnachrichten mit, wenn es sinnvoll ist; Langzeitgedächtnis und kurzfristiger Kontext können zusammenarbeiten.
- Schreiben Sie bei der Gruppenchat-Simulation Sprechernamen manuell in
content. Die API leitet Namen nicht ausprofileab. - Verwenden Sie
partial: truenur in der abschließenden Assistant-Nachricht, wenn das Modell ab einem Präfix fortfahren soll. - Nutzen Sie Qwen Flash Character für leichtgewichtiges Rollenspiel und Qwen Plus Character für reichere Dialogqualität.