Ви розмовляєте. Слова потрапляють — у ваш редактор, термінал, чат-вікно, форму, де б не знаходився курсор. І кожне з них залишається на пристрої, на якому ви їх вимовили.
Brethof Voice Pro – це засіб для перекладу та конвертації голосу в текст, який працює повністю на вашому власному комп’ютері. Це не функція забезпечення приватності; це сам продукт.
Одна програма – робота чотирьох людей. Вона транскрибує ваш голос, перекладає його на 38 мов, додає субтитри до ваших відео та друкує текст там, де потрібна клавіатура. Вона працює офлайн – у літаку, у готелі з поганим інтернетом, у тунелі – а також на вашому ноутбуці, з графічною карткою чи без неї. Жодних підписок. Жодного обліку за хвилини. Жодних завантажень. Дайте своєму штучному інтелекту „вуха“ також: він може транскрибувати, перекладати та записувати зустріч будь-якої тривалості через MCP на вашому пристрої без API-ключа. Купіть його один раз – і він буде працювати далі.
Ваш голос ніколи не виходить за межі вашого комп’ютера. Це точне формулювання. Під час запуску у мережу надсилаються лише три речі: перевірка ліцензії, перевірка оновлень та моделі, які ви самі завантажуєте. Перевірка ліцензії надсилає ключ ліцензії, а перевірка оновлень – рядок версії; жодного аудіо чи тексту. Якщо вимкнути перевірку оновлень, то після того, як моделі будуть збережені на диску, нічого більше не надсилатиметься.
Транскрипція більш ніж 30 мов, а також 22 китайські регіональні діалекти розпізнаються автоматично — без налаштувань та навчання. Крім того, ваш акцент більше не буде спотворюватися. Brethof Voice Pro самостійно вивчає ваш голос, специфічну лексику та власні імена на вашому пристрої. Навіть якщо ви говорите на діалекті Сичуань, як ваша бабуся, все буде правильно.
Говоріть польською, читайте англійською. Говоріть англійською, читайте японською. Або сказати один раз, і текст буде введений англійською, японською, французькою та іспанською одночасно — по одному на рядок або поруч у одному рядку. Виберіть стільки цільових мов, скільки бажаєте; їх є 38, причому 23 підтримують двосторонній переклад. Переклад також виконується на вашому пристрої, за допомогою Tencent’s Hunyuan MT2. За показниками якості він досягає 97,9% рівня Google’s Gemini 3.1 Pro на тестовому наборі FLORES-200 та перевершує його у перекладі реальних текстів та текстів меншинних мов. Є два формати, обидва доступні для завантаження за бажанням: швидкий для повсякденного використання та якісний для важливих текстів. Також є субтитри — у простому форматі або SRT, з таймінгом за реченнями або по словах, якщо потрібна точна редагування. Перекладаючи файл субтитрів, таймінг зберігається. Додайте субтитри до свого відео 38 мов
Ось чому він працює там, де ніщо інше не спрацює. Літак. Готель з поганим інтернетом. Поїзд у тунелі. Немає куди передавати ваш запис, тож йому не потрібно нікуди йти. Залиште запис двогодинної зустрічі та йдіть готувати каву; транскрипт буде готовий, коли ви повернетеся. Забудьте, що залишили записування – нічого не загубиться; він сам завершує роботу та зберігає транскрипт.
Два моделі транскрипції, і це вибір, а не рівень — ви можете змінити їх у будь-який час.
Більшість програм для голосу під час налаштування вимагають від вас прочитати зразки речень. Ця програма так не робить. Вона навчається на виправленнях, які ви вже вносите: якщо ви виправляєте неправильно почуте слово, це виправлення стає прикладом для навчання. Як тільки ви внесете імена своїх брендів, спеціальної термінології чи колег, вони більше не будуть виводитися неправильно — ні у текстовому записі, ні у перекладі, адже один і той самий список керує обома процесами. Ім’я ніколи не локалізується випадково. Навчання займає один клік, відбувається на вашому обладнанні, а нова модель готова до використання після завершення процесу.
Купіть його один раз — і воно буде вашим. Постійна ліцензія з роком оновлень у комплекті.
Шумна кімната більше не є проблемою. Функція зниження шуму вбудована для записів, зроблених у кафе, на виставці чи в автомобілі. Вона вимкнена за замовчуванням, адже ми це перевірили: на коротких, якісних записах з мікрофона це погіршує якість звуку. Для двогодинної зустрічі з еспресо-апаратом позаду вас увімкніть її.
Клавіатура голосу вводить текст там, де знаходиться ваш Cursor – у браузері, IDE, чат-додатку чи будь-якому полі, яке підтримує введення через клавіатуру. Вона може вводити переклад замість транскрипції. Скажіть речення своєю мовою, і правильні слова потраплять у форму мовою, яка їй потрібна. Одна лінія, без обрізання та вставки.
0,6 Б – це модель для щоденного використання. Вона працює на будь-якій відеокарті об’ємом 4 ГБ, на інтегрованій відеокарті, а також у ноутбуках без відеокарти. Швидка, легка, завжди під рукою, коли потрібна.
1,7 млрд – це оптимальний варіант для аудіо з акцентами чи шумом, а також під час двогодинних зустрічей, де важливі кожні слова. Для його роботи потрібно близько 6 ГБ оперативної пам’яті; якщо одночасно використовувати модель високоякісного перекладу, потрібно 8 ГБ.
Жодної відеокарти? Програма все одно працює. Для роботи лише на процесорі потрібно 8 ГБ ОЗУ, чотирьохядерний процесор та приблизно 5 ГБ вільного місця на диску; для всього іншого потрібно 7–9 ГБ. Підійде будь-яка карта з підтримкою Vulkan 1.2+ — NVIDIA, AMD, Intel Arc. Крім того, процес транскрипції та перекладу використовують окремі процесори, тож один може працювати на відеокарті, а інший — на процесорі.
Додаткові додатки можна завантажити за потребою з розділу Налаштування → Моделі:
Forced Aligner (~540 МБ) для часових позначок на рівні слів · Hunyuan MT2 Fast (~1 ГБ) або Якість (~4,3 ГБ) для перекладу.
| Функція | Brethof Voice Pro | Dragon | Google STT | Otter.ai | Whisper (OSS) |
|---|---|---|---|---|---|
| 100% локальна обробка | ✓ | ✓ | ✗ | ✗ | ✓ |
| Довічна ліцензія | ✓ | ~ | ✗ | ✗ | ✓ |
| Нативна підтримка Linux | ✓ | ✗ | ~ | ✗ | ✓ |
| Нативна підтримка Windows | ✓ | ✓ | ~ | ✗ | ~ |
| 30 мов ASR + автоматичне виявлення | ✓ | ✗ | ✓ | ~ | ✓ |
| Офлайн-переклад (38 мов) | ✓ | ✗ | ✗ | ✗ | ✗ |
| Прискорення за допомогою GPU (NVIDIA + AMD + Intel) | ✓ | ✗ | N/A | N/A | ~ |
| Тонке налаштування персональної моделі (LoRA) | ✓ | ✓ | ✗ | ✗ | ✗ |
| Сервер MCP для AI-агентів | ✓ | ✗ | ✗ | ✗ | ✗ |
| Вбудоване зниження шуму | ✓ | ✓ | ✓ | ✓ | ✗ |
| Пряме вставлення тексту | ✓ | ✓ | ✗ | ✗ | ✗ |
| Вдосконалений настільний графічний інтерфейс | ✓ | ✓ | ✗ | ✓ | ✗ |
| Типова вартість | $49 одного разу | $350+/рік | $17/міс. | $17/міс. | Безкоштовно |
Жодних щомісячних платежів. Жодних обмежень на використання. Постійна ліцензія з 1 роком оновлень включно.
Кредитна картка не потрібна. Достатньо лише електронної адреси для підтвердження пробної версії.
Довічна ліцензія. 2 особисті пристрої. Включено 1 рік оновлень.
Ціни без податків. Потім 20 доларів на рік за оновлення (необов’язково).
Перманентна ліцензія на кожного користувача. Для команд та організацій. 1 рік оновлень.
Ціни без податків. Додатково 20 доларів/користувач/рік за оновлення (необов’язково)
Ні. Brethof Voice Pro обробляє все локально на вашому пристрої. Жодні аудіо чи текстові дані ніколи не покидають ваш комп’ютер. Немає жодних хмарних компонентів, телеметрії чи аналітики.
Підійде будь-яка сучасна відеокарта. NVIDIA, AMD та Intel Arc використовують прискорення Vulkan. Також можна працювати лише на процесорі, хоча транскрипція буде повільнішою. Модель 0.6B комфортно працює на інтегрованій графіці або будь-якій відеокарті з 4 ГБ+ пам'яті та підтримкою Vulkan.
Почніть з Модель 0,6B — Це рекомендований стандартний варіант, який чудово працює на більшості GPU (а навіть на CPU у більшості сучасних пристроїв). Якщо вам потрібна вища точність для аудіо з акцентами чи шумом, перейдіть на Модель 1,7B (потрібно 6 ГБ+ VRAM). Ви можете змінювати розмір моделі в будь-який час у розділі Налаштування → Моделі без повторного завантаження.
Так. Brethof Voice Pro підтримує як Linux, так і Windows нативно. На Linux він працює з X11 та Wayland. На Windows він працює як стандартний десктопний додаток.
Ваша ліцензія є довічною — додаток працюватиме вічно з тією версією, яку ви маєте. Опційний пакет оновлень за 20 доларів на рік дає доступ до нових функцій та покращень моделей. Без нього ви просто залишаєтесь на поточній версії.
Так — особисте навчання голосу включено у версію v2.0.0 та відбувається повністю на вашому пристрої. Кожного разу, коли ви виправляєте неправильно розпізнане слово, пара {clip, correction} автоматично зберігається у вашому локальному наборі даних для навчання. На картці навчання у головному вікні одразу видно загальну кількість зразків та час, який було записано — натисніть „Почати навчання“ у вкладці Навчання, щоб налаштувати LoRA під ваш акцент. Результат автоматично експортується у форматі GGUF, і ви можете одним кліком перейти до нього. Ця функція безкоштовна для кожної оплаченої ліцензії, а ваші дані голосу ніколи не покидають ваш пристрій.
14-денна безкоштовна пробна версія. Без кредитної картки. Без хмари. Без компромісів.
Локальне розпізнавання мовлення в текст, що вивчає ваш голос. Постійна ліцензія. Наш флагман.
Оплачено · флагман
Довгострокова пам’ять для ваших штучних інтелектуальних агентів — повний текст + вектори + графи. Інформація надається на початку сеансу, відтворюється при кожному запиті та автоматично архівується.
Оплачено · безкоштовний тариф
Цифрові моделі, готові до друку. Формати GLB та OBJ включено. Доступ на все життя.
Оплачено · цифровий каталог
П’ять принтерів та справжня продуктивність. Поки що немає магазину самообслуговування — скажіть нам, що вам потрібно, і ми надішлемо ціну електронною поштою.
За домовленістю · надішліть нам електронний лист
Наш канал на YouTube. Ведучий-кібертигр розглядає місцеві інструменти штучного інтелекту та те, що вони насправді роблять.
КАНАЛ · пряма трансляція
Відібрані списки на GitHub для агентів кодування на основі ШІ, серверів MCP, локальних рішень для ШІ та Linux для ШІ. Кожен запис містить посилання на джерело.
БЕЗКОШТОВНО · ретельно відібрано
Детальні інструкції щодо використання локального ШІ на Linux, Windows та macOS, з файлами конфігурації.
БЕЗКОШТОВНО · пряма трансляція
Негативна кураторія: практики та інструменти, які марнують ваш час, відсортовані за рейтингом. Обов'язкове надання доказів.
БЕЗКОШТОВНО · пряма трансляція
Хто ми, чому ми створюємо ШІ, орієнтований на приватність, і що ми не будемо робити.