API Qwen Character
เอกสารอ้างอิง API ฉบับสมบูรณ์สำหรับโมเดลสวมบทบาทตัวละคร Qwen โดย Alibaba โมเดล Qwen Character ใช้ endpoint chat completions ของ Flaq AI แต่ยังรองรับฟิลด์เฉพาะตัวละครสำหรับหน่วยความจำระยะยาว การจำลองแชตกลุ่ม และการต่อข้อความ assistant แบบบางส่วน
รุ่นย่อยของโมเดล {#}
API นี้รองรับโมเดลสองรุ่นย่อย:
การเปรียบเทียบอย่างรวดเร็ว
การสวมบทบาทตัวละครทำงานอย่างไร
ใช้ข้อความ system, user และ assistant ตามปกติสำหรับการสวมบทบาทตัวละครเดียว ใส่คำสั่ง persona ที่คงที่สำหรับคำขอปัจจุบันไว้ในข้อความ system เมื่อเปิดใช้หน่วยความจำระยะยาว ให้ใส่โปรไฟล์ตัวละครที่ใช้ซ้ำได้ใน profile
สำหรับการจำลองแชตกลุ่ม Qwen Character จะไม่อนุมานชื่อผู้พูดจาก profile โดยอัตโนมัติ ผู้เรียกต้องเขียนชื่อผู้พูดไว้ที่จุดเริ่มต้นของ content ในแต่ละข้อความ เช่น Cheng Yi: หรือ Ling Lu: หากต้องการให้โมเดลตอบต่อในฐานะตัวละครที่กำหนด ให้เพิ่มข้อความ assistant สุดท้ายที่มี content เป็นคำนำหน้าผู้พูดเป้าหมาย และตั้งค่า partial: true
partial เป็นฟิลด์ระดับข้อความบนข้อความ assistant สุดท้าย ไม่ใช่พารามิเตอร์คำขอระดับบนสุด
Qwen Plus Character
จุดปลายทาง
http
พารามิเตอร์คำขอ
จำเป็น
Header
การรองรับข้อความ
ฟิลด์ข้อความ
ไม่บังคับ
เมื่อเปิดใช้หน่วยความจำระยะยาว คุณต้องระบุ:
- header คำขอ
x-session profileใน body คำขอenable_long_term_memory: true
skip_save_types รองรับค่าต่อไปนี้:
คำขอสวมบทบาทพื้นฐาน
javascript
คำขอหน่วยความจำระยะยาว
javascript
การจำลองแชตกลุ่มด้วย partial
การจำลองแชตกลุ่มทำผ่านข้อความใน message API จะไม่กำหนดหรือย้ายชื่อผู้พูดโดยอัตโนมัติ เขียนชื่อผู้พูดแต่ละคนด้วยตนเองที่จุดเริ่มต้นของ content แล้วเพิ่มข้อความ assistant สุดท้ายพร้อมคำนำหน้าผู้พูดเป้าหมายและ partial: true
javascript
ให้ตัวละครพูดต่อด้วย partial
ใช้รูปแบบ partial เดียวกันเมื่อผู้ใช้ยังไม่ได้ตอบ แต่คุณต้องการให้ตัวละครพูดต่อ เพิ่มข้อความ assistant สุดท้ายพร้อมคำนำหน้าตัวละคร
javascript
Qwen Flash Character
พารามิเตอร์คำขอ
ใช้โปรโตคอลเดียวกับ Qwen Plus Character โดยมีความแตกต่างดังนี้:
ตัวอย่างคำขอ
javascript
รูปแบบการตอบกลับ
โมเดล LLM Qwen Character ส่งคืนการตอบกลับแบบ completion ที่เข้ากันได้กับ OpenAI เมื่อใช้ stream: true การตอบกลับจะอยู่ในรูปแบบ Server-Sent Events; เมื่อใช้ stream: false การตอบกลับจะเป็นออบเจ็กต์ JSON เดียว
แนวทางปฏิบัติที่ดีที่สุด
- ใส่คำสั่ง persona ระดับคำขอในข้อความ
system - ใส่พื้นหลังตัวละครที่ใช้ซ้ำได้ใน
profileเฉพาะเมื่อเปิดใช้หน่วยความจำระยะยาว - ใช้ค่า
x-sessionเดิมซ้ำในบทสนทนาที่เกี่ยวข้องเมื่อเปิดใช้หน่วยความจำระยะยาว เซสชันที่ไม่ได้ใช้งานเป็นเวลา 365 วันอาจถูกล้าง - ส่งข้อความบทสนทนาล่าสุดต่อไปเมื่อมีประโยชน์ หน่วยความจำระยะยาวและบริบทระยะสั้นสามารถทำงานร่วมกันได้
- สำหรับการจำลองแชตกลุ่ม ให้เขียนชื่อผู้พูดใน
contentด้วยตนเอง API จะไม่อนุมานชื่อจากprofile - ใช้
partial: trueเฉพาะในข้อความ assistant สุดท้ายเมื่อโมเดลควรเขียนต่อจากคำนำหน้า - ใช้ Qwen Flash Character สำหรับการสวมบทบาทแบบเบา และใช้ Qwen Plus Character สำหรับคุณภาพบทสนทนาที่สมบูรณ์กว่า