Личната обука на гласот е испорачана во Brethof Voice Pro. Прилагодете го моделот за препознавање на вашиот сопствен глас, локално, со еден клик — без командна линија, без облак. Еве како функционира.
Како функционира
Секој пат кога ќе исправите погрешно препознаен збор, апликацијата го зачувува аудио клипот и вашата исправка во локален сет на податоци за обука. Картичката за обука во главниот прозорец покажува колку примероци и минути сте собрале — кликнете за да прелистувате, пуштате или бришете записи. Кога сте подготвени, јазичето „Обука“ врши фино подесување на LoRA адаптер врз вашиот глас.
Пајплајнот автоматски го избира својот бекенд: еден NVIDIA CUDA градба (cu128 PyTorch, автоматски инсталирана во кеширан venv при првото стартување) кога е присутна компатибилна GPU, во спротивно CPU fallback. Кога тренирањето ќе заврши, LoRA се спојува со базниот модел и се експортира во GGUF за да може llama.cpp да го вчита – префрлете се на вашиот личен модел преку Поставки → Модели. Конверзијата од PyTorch во GGUF, која претходно го блокираше ова, е завршена и работи од крај до крај.
Што добивате
- Собирање податоци во апликацијата. Корекциите автоматски стануваат податоци за обука — само продолжете да ја користите апликацијата.
- Едноклично LoRA дотерување. Тренирајте на вашиот GPU (NVIDIA CUDA) или CPU. Лента за напредок, а не датотека со логови.
- Автоматски GGUF извоз. Тренираниот модел е споен и конвертиран за вас — без рачни чекори.
- Верзионирање на модели. Чувајте го стандардниот модел заедно со вашиот фино подесен и префрлајте се меѓу нив во поставките.
- Клучни зборови за речник. Додадете имиња, акроними и термини за производи во дијалогот за „Hotwords“ — се применуваат веднаш, без потреба од повторно обучување.
За кого е важно ова
- Говорници на странски јазик. Тешките акценти денес постигнуваат солидна основна точност, но финото подесување врз вашиот сопствен глас е она што ја искачува во опсегот над 95%.
- Медицински, правни и технички корисници. Имиња на лекови, цитати од судска пракса, идентификатори во кодната база — сето тоа има огромна корист од прилагоден речник.
- Корисници со нарушен говор. Финото подесување на дисартричен или атипичен говор е една од највредните употреби на локалната обука. Комерцијалните облачни услуги не го нудат тоа.
- Јазици со малку ресурси. Базните модели се добри во популарните јазици и послаби во помалку честите. Со фино подесување на неколку часа од вашето сопствено аудио, разликата брзо се намалува.
Што не се менува
- Тренирањето се одвива локално. Гласовните примероци никогаш не го напуштаат вашиот уред. Тоа е целата поента.
- Вашиот фино-прилагоден модел е ваш. Не го отпремаме. Не го спојуваме во „заеднички“ модел. Тој живее на вашиот диск.
- Бесплатно со која било платена лиценца. Не е посебна надградба. Ако веќе имате Personal или Business, го добивате интерфејсот за обука во ажурирањето што го носи.
Достапност
Достапно сега — Обучувањето за личен глас е вклучено во тековната верзија и работи end-to-end на Linux и Windows. Бесплатно со секоја платена лиценца; вашите податоци за глас никогаш не го напуштаат вашиот уред.
Имате конкретен случај за фино подесување — специјализирани речници, необични акценти, атипичен говор? Кажете ни за да продолжиме да го подобруваме: [email protected].