آموزش صدای شخصی در Brethof Voice Pro ارائه شد. مدل تشخیص را بر اساس صدای خودتان بهصورت محلی و با یک کلیک تنظیم کنید — بدون خط فرمان، بدون ابر. نحوه عملکرد آن به این صورت است.
نحوه کار
هر بار که یک کلمه را که به اشتباه شناسایی شده بود، اصلاح میکنید، این برنامه فایل صوتی و اصلاحات شما را در یک مجموعه داده آموزشی محلی ذخیره میکند. کارت آموزش در پنجره اصلی تعداد نمونهها و دقایقی را که ضبط کردهاید نشان میدهد؛ بر روی آن کلیک کنید تا بتوانید آنها را مرور کنید، پخش کنید یا حذف کنید. وقتی آماده شدید، تب آموزش یک آداپتور LoRA را بر روی صدای شما تنظیم خواهد کرد.
این پایپلاین، سیستم پشتیبان خود را بهطور خودکار انتخاب میکند: یک NVIDIA CUDA ساخته میشود (cu128 PyTorch، نصب خودکار در یک venv کششده در اولین اجرا) هنگامی که یک GPU سازگار وجود داشته باشد، در غیر این صورت یک CPU جایگزین. پس از اتمام آموزش، LoRA با مدل پایه ادغام شده و به GGUF صادر میشود تا llama.cpp بتواند آن را بارگیری کند — از مدل شخصی خود در Settings → Models استفاده کنید. تبدیل PyTorch به GGUF که قبلاً این کار را مسدود میکرد، انجام شده و به صورت end-to-end اجرا میشود.
آنچه دریافت میکنید
- جمعآوری داده درونبرنامهای. اصلاحات به طور خودکار به دادههای آموزشی تبدیل میشوند؛ فقط به استفاده از اپلیکیشن ادامه دهید
- تنظیم دقیق LoRA با یک کلیک. آموزش را روی GPU (NVIDIA CUDA) یا CPU انجام دهید. نوار پیشرفت، نه فایل لاگ.
- صادرات خودکار GGUF. مدل آموزشدیده برای شما ادغام و تبدیل میشود — بدون نیاز به مراحل دستی.
- نسخهبندی مدل. مدل پیشفرض را کنار مدل تنظیمشده خود نگه دارید و در تنظیمات بین آنها جابهجا شوید.
- کلمات کلیدی برای واژگان. نامها، مخففها و اصطلاحات محصول را در پنجره کلمات کلیدی (Hotwords) وارد کنید — بهطور فوری اعمال میشوند و نیاز به آموزش مجدد نیست.
این موضوع برای چه کسانی اهمیت دارد؟
- گویندگان غیربومی. لهجههای سنگین امروز دقت پایهای قابل قبولی دارند، اما تنظیم دقیق روی صدای خودتان همان جایی است که دقت به محدوده ۹۵٪+ میپرد.
- کاربران حوزههای پزشکی، حقوقی و فنی. نامهای داروها، استنادهای حقوقی، شناسههای پایگاه کد — همگی از یک واژگان سفارشی به طور چشمگیری بهره میبرند.
- کاربرانی که دچار مشکلات گفتاری هستند. تنظیم دقیق برای گفتار نامناسب یا غیرطبیعی، یکی از کاربردهای با ارزش بالای آموزش محلی است. سرویسهای ابری تجاری چنین امکانی را فراهم نمیکنند.
- زبانهای کممنابع. مدلهای پایه در زبانهای پرکاربرد خوب و در زبانهای کمتر رایج ضعیفتر هستند. فاینتیون روی چند ساعت از صدای خودتان و شکاف به سرعت بسته میشود.
چه چیزی تغییر نمیکند؟
- آموزش بهصورت محلی اجرا میشود. نمونههای صدا هرگز از دستگاه شما خارج نمیشوند. این همان مفهوم کلی است.
- مدل فاینتیونشده شما متعلق به خودتان است. ما آن را آپلود نمیکنیم. آن را در یک مدل «مشترک» تجمیع نمیکنیم. آن در دیسک شما باقی میماند.
- با هر مجوز پولی، رایگان است. این یک ارتقای جداگانه نیست. اگر در حال حاضر نسخه Personal یا Business را دارید، رابط کاربری آموزش در بهروزرسانی آن ارائه میشود.
دسترسیپذیری
هماکنون موجود است — آموزش صدای شخصی در بیلد فعلی ارائه میشود و بهطور کامل روی Linux و Windows اجرا میشود. رایگان با هر لایسنس پولی؛ دادههای صدای شما هرگز از دستگاه شما خارج نمیشود.
اگر کاربرد خاصی برای تنظیم دقیق دارید — واژگان تخصصی، لهجههای غیرمعمول، یا گفتار غیرمتعارف؟ به ما اطلاع دهید تا به بهبود آن ادامه دهیم: [email protected].