Tool: speak — อ่านคำตอบออกเสียงผ่านลำโพงของเครื่อง

ภาพรวมระบบสำหรับ: Tool: speak — อ่านคำตอบออกเสียงผ่านลำโพงของเครื่องspeak ใช้ macOS text-to-speech อ่านคำตอบให้ฟังเมื่อผู้ใช้ร้องขอ โดยล้าง Markdown จำกัดความยาว และยังส่งคำตอบข้อความตามปกติเตรียมคำตอบขั้นที่ 1ล้าง Markdownขั้นที่ 2อ่านออกเสียงขั้นที่ 3ส่งข้อความด้วยขั้นที่ 4อ่านคำตอบผ่านลำโพงเครื่อง
ภาพประกอบระบบภาพนี้สรุปขั้นตอนของ อ่านคำตอบผ่านลำโพงเครื่อง ตามกลไกที่อธิบายในบทความ

speak ใช้ text-to-speech ที่มากับ macOS เพื่ออ่านข้อความผ่านลำโพงของเครื่องที่รัน Agent เท่านั้น ให้เรียกเมื่อผู้ใช้ขอให้อ่านออกเสียง ไม่เรียกเองโดยไม่มีคำขอ

ข้อความที่อ่านและสิ่งที่ผู้ใช้ได้รับ

จัดคำตอบให้เสร็จก่อน แล้วส่งข้อความเดียวกันให้ speak; หลังจากนั้นยังตอบข้อความปกติใน chat ด้วย เพราะเสียงเป็นช่องทางเพิ่มเติม ไม่ได้แทนคำตอบที่อ่านได้

tool ลบ Markdown และ whitespace ที่ไม่จำเป็น แล้วจำกัดความยาวไว้ประมาณ 800 ตัวอักษร โดยตัดที่ขอบเขตประโยคหรือวลีเมื่อทำได้ ภาษาไทยเลือก voice ภาษาไทย (ค่าเริ่มต้น Kanya) การเล่นเสียงเริ่มใน background จึงคืนสถานะทันที และคำเรียกที่ซ้อนกันจะเล่นต่อคิวไม่ทับเสียงก่อนหน้า

เสียงไม่ถูกส่งกลับเป็นไฟล์เสียงหรือแนบเข้า chat; ถ้าเครื่องไม่มี macOS say จะคืน error แทนการเล่นเสียง

อ่านเพิ่มเติม

ความคิดเห็น

กำลังโหลดความคิดเห็น...