การฝึกเสียงส่วนบุคคลมาพร้อมกับ Brethof Voice Pro คุณสามารถปรับแต่งโมเดลการจดจำเสียงให้เข้ากับเสียงของคุณเองได้ทันทีผ่านการคลิกเพียงครั้งเดียว โดยไม่จำเป็นต้องใช้บรรทัดคำสั่งหรือระบบคลาวด์ นี่คือวิธีการทำงาน
วิธีการทำงาน
ทุกครั้งที่คุณแก้ไขคำที่ถูกรู้จำผิด แอปพลิเคชันจะบันทึกคลิปเสียงและการแก้ไขของคุณไว้ในชุดข้อมูลฝึกฝนแบบท้องถิ่น บนหน้าต่างหลัก แท็บการฝึกฝนจะแสดงจำนวนตัวอย่างและจำนวนนาทีที่คุณได้บันทึกไว้ — คลิกที่นั่นเพื่อดู ฟัง หรือลบรายการต่างๆ เมื่อคุณพร้อมแล้ว แท็บการฝึกฝนจะทำการปรับแต่งอะแดปเตอร์ LoRA ให้เหมาะกับเสียงของคุณ
ระบบจะเลือกแบ็กเอนด์อัตโนมัติ: NVIDIA CUDA สร้างขึ้น (cu128 PyTorch จะถูกติดตั้งอัตโนมัติในสภาพแวดล้อม venv ที่ถูกเก็บไว้เมื่อรันครั้งแรก) เมื่อมี GPU ที่เข้ากันได้อยู่ มิฉะนั้นจะไม่มีการสร้าง ซีพียู วิธีสำรอง หลังจากการฝึกเสร็จสิ้น จะมีการผสาน LoRA เข้ากับโมเดลพื้นฐานแล้วส่งออกเป็นรูปแบบ GGUF เพื่อให้ llama.cpp สามารถโหลดมาใช้ได้ — สามารถเปลี่ยนไปใช้โมเดลส่วนตัวของคุณได้ที่ Settings → Models การแปลงจาก PyTorch เป็น GGUF ซึ่งเคยเป็นอุปสรรคนี้ ตอนนี้สามารถทำได้และดำเนินการได้อย่างต่อเนื่อง
สิ่งที่คุณจะได้รับ
- การเก็บรวบรวมข้อมูลภายในแอปพลิเคชัน การแก้ไขกลายเป็นข้อมูลการฝึกโดยอัตโนมัติ — เพียงแค่ใช้งานแอปต่อไป
- การปรับแต่ง LoRA ด้วยคลิกเดียว ฝึกบน GPU ของคุณ (NVIDIA CUDA) หรือ CPU มีแถบความคืบหน้า ไม่ใช่ไฟล์บันทึก
- ส่งออกในรูปแบบ GGUF อัตโนมัติ โมเดลที่ได้รับการฝึกจะถูกผสานและแปลงให้คุณ — ไม่ต้องทำขั้นตอนด้วยตนเอง
- การกำหนดเวอร์ชันของโมเดล เก็บโมเดลต้นแบบไว้คู่กับโมเดลที่ปรับแต่งแล้ว และสลับใช้งานระหว่างทั้งสองในการตั้งค่า
- คำสำคัญสำหรับคลังศัพท์ เพิ่มชื่อ คำย่อ และคำศัพท์ของผลิตภัณฑ์ในกล่องโต้ตอบ Hotwords — จะมีผลทันที ไม่ต้องฝึกโมเดลใหม่
ใครบ้างที่ได้รับผลกระทบจากเรื่องนี้
- ผู้ใช้ที่ไม่ใช่เจ้าของภาษา ปัจจุบันระบบที่มีสำเนียงหนักก็สามารถให้ความแม่นยำในระดับที่ดีได้แล้ว แต่การปรับแต่งระบบให้เหมาะกับสำเนียงของคุณเองจะช่วยให้ความแม่นยำพุ่งขึ้นไปอยู่ในระดับ 95% ขึ้นไปได้
- ผู้ใช้ด้านแพทย์ กฎหมาย และเทคนิค ชื่อยา ข้ออ้างอิงจากคำพิพากษา รวมถึงรหัสต่างๆ ล้วนได้รับประโยชน์อย่างมากจากการใช้คำศัพท์เฉพาะที่กำหนดขึ้นเอง
- ผู้ที่มีความบกพร่องด้านการพูด การปรับแต่งโมเดลสำหรับผู้ที่มีปัญหาในการพูดหรือมีลักษณะการพูดที่ผิดปกติ ถือเป็นหนึ่งในการใช้งานที่มีคุณค่าสูงสุดของการฝึกโมเดลในระดับท้องถิ่น บริการคลาวด์เชิงพาณิชย์ไม่มีบริการนี้ให้
- ภาษาที่มีทรัพยากรจำกัด โมเดลพื้นฐานมีประสิทธิภาพดีในภาษาที่ได้รับนิยม แต่จะอ่อนแอลงในภาษาที่ไม่ค่อยมีการใช้งาน หากทำการปรับแต่งโมเดลด้วยเสียงของคุณเองเพียงไม่กี่ชั่วโมง ช่องว่างดังกล่าวก็จะลดลงอย่างรวดเร็ว
สิ่งที่ไม่มีการเปลี่ยนแปลง
- การฝึกทำงานในเครื่อง ตัวอย่างเสียงจะไม่มีวันออกจากเครื่องของคุณเลย นั่นแหละคือจุดประสงค์หลัก
- โมเดลที่ปรับแต่งแล้วเป็นของคุณ เราไม่ได้อัปโหลดมัน และเราก็ไม่ได้นำมันเข้าไปไว้ในโมเดล “แบบแชร์” มันจะอยู่บนดิสก์ของคุณเอง
- มาพร้อมฟรีกับใบอนุญาตแบบเสียค่าใช้จ่ายใดๆ ก็ตาม ไม่ใช่การอัปเกรดแยกต่างหาก หากคุณมีแผน Personal หรือ Business อยู่แล้ว คุณจะได้รับการอัปเดตพร้อมอินเทอร์เฟซสำหรับการฝึกโมเดล
ความพร้อมใช้งาน
มีให้บริการแล้ววันนี้ — การฝึกเสียงส่วนบุคคลมีให้ใช้ในเวอร์ชันปัจจุบันและทำงานแบบ end-to-end บน Linux และ Windows ฟรีเมื่อซื้อใบอนุญาต ข้อมูลเสียงของคุณจะไม่ออกจากระบบของคุณเลย
มีกรณีการใช้งานเฉพาะเจาะจง เช่น คำศัพท์เฉพาะทาง สำเนียงที่ไม่ปกติ หรือลักษณะการพูดที่แตกต่างจากปกติ? แจ้งให้เราทราบเพื่อที่เราจะได้ปรับปรุงต่อไป: [email protected].