100% lokalnie — Twój głos nigdy nie opuszcza Twojego urządzenia

Głos do tekstu nigdy nie odchodzi twój komputer

Rozmawiasz. Słowa trafiają – do twojego edytora, terminala, okna czatu, formularza, wszędzie tam, gdzie znajduje się kursor. I każde z nich pozostaje na komputerze, na którym je wypowiedziałeś.

Brethof Voice Pro to narzędzie do konwersji mowy na tekst oraz tłumaczenia, które działa wyłącznie na twoim komputerze. To nie jest funkcja związana z ochroną prywatności – to sama istota tego produktu.

100% lokalnie — Bez chmury nigdy
30 ASR + 38 Tłumaczenie języki
Przyspieszenie GPU — NVIDIA, AMD, Intel
Linux i Windows
Działa offline

Wszystko, czego potrzebujesz, niczego, czego nie potrzebujesz

Jeden program, praca czterech osób. Transkrybuje twój głos, tłumaczy go na 38 języków, dodaje napisy do twoich filmów oraz pisze za ciebie tam, gdzie jest klawiatura. Działa offline – w samolocie, w hotelu z słabym Wi-Fi, w tunelu – oraz na laptopie, który już posiadasz, z kartą graficzną lub bez niej. Brak subskrypcji. Brak opłat za minutę. Brak konieczności przesyłania danych. Daj też swojemu agentowi AI uszy: może on transkrybować, tłumaczyć i nagrywać spotkania dowolnej długości za pośrednictwem MCP, na twoim urządzeniu, bez klucza API. Kup go raz i będzie działał bez przerwy.

Trzy rzeczy dotykają sieci, i nic innego tego nie robi

Twój głos nigdy nie opuszcza twojego komputera. To zdanie jest precyzyjne i oddaje istotę sprawy. Podczas uruchamiania do sieci trafiają tylko trzy rzeczy: sprawdzenie licencji, sprawdzenie aktualizacji oraz modele, które sam pobierasz. Sprawdzenie licencji wysyła klucz licencyjny, a sprawdzenie aktualizacji – ciąg znaków wskazujący wersję – nigdy żadnego dźwięku ani tekstu. Wyłącz sprawdzenie aktualizacji, a gdy modele znajdą się na dysku, nic już nie zostanie wysłane.

30 języków, 22 dialekty – twój akcent przestaje być problemem

Transkrypcja w ponad 30 językach, a 22 chińskie dialekty regionalne są rozumiane automatycznie – bez konfiguracji, bez szkolenia. Twoje akcenty przestaną być błędnie interpretowane. Brethof Voice Pro uczy się twojego głosu, specjalistycznej terminologii oraz nazw własnych na twoim własnym urządzeniu. Mów po syczuańsku jak twoja babcia – wszystko będzie brzmieć poprawnie.

Powiedz raz, przeczytaj to w 38 językach

Mów po polsku, czytaj po angielsku. Mów po angielsku, czytaj po japońsku. Albo powiedz to raz, a tekst zostanie wpisany jednocześnie po angielsku, japońsku, francusku i hiszpańsku – po jednym w linii lub obok siebie w tej samej linii. Wybierz tyle języków docelowych, ile chcesz; jest ich 38, a 23 działają w obu kierunkach. Tłumaczenie odbywa się również na twoim komputerze, za pomocą systemu Hunyuan MT2 firmy Tencent. Przy takiej jakości osiąga 97,9% wyniku systemu Gemini 3.1 Pro firmy Google w teście FLORES-200, a przewyższa go przy tłumaczeniach w rzeczywistym świecie oraz językach mniejszościowych. Dostępne są dwa warianty rozdzielczości, oba do pobrania opcjonalnie: szybszy do codziennego użytku, wysokiej jakości dla ważniejszych tekstów. Dostępne są również napisy – w formie tekstu prostego lub SRT, z synchronizacją według zdań lub słów, gdy potrzebujesz dokładnej edycji. Tłumacząc plik z napisami, cała synchronizacja zostaje zachowana. Dodaj napisy do swojego filmu w 38 językach bez płacenia za każdą minutę.

Całkowicie offline

Dlatego działa tam, gdzie nic innego nie zadziała. Samolot. Hotel z kiepskim Wi-Fi. Pociąg jadący przez tunel. Nie ma dokąd trafić nagraniu, więc nie musi nigdzie iść. Wgraj nagranie dwugodzinnego spotkania i idź zaparzyć kawę; transkrypcja będzie już gotowa, gdy wrócisz. Zapomnij, że włączyłeś nagrywanie – nic się nie straci; urządzenie samo dokończy pracę i zachowa transkrypcję.

Dwa rozmiary modeli

Dwa modele transkrypcji, i to jest wybór, a nie poziom – możesz je zmieniać w dowolnym momencie.

Uczy się na podstawie poprawek, które już wprowadzasz.

Większość oprogramowania do przetwarzania mowy wymaga od użytkownika odczytywania przykładowych zdań podczas konfiguracji. To oprogramowanie tak nie robi. Uczy się na podstawie korekt, które już wprowadzasz: poprawiasz błędnie usłyszane słowo, a ta korekta staje się przykładem do szkolenia. Po raz jedyny ustaw swoje nazwy firmowe, żargon oraz imiona kolegów – wtedy przestaną pojawiać się błędnie, zarówno w transkrypcji, jak i w tłumaczeniu, ponieważ ta sama lista steruje obydwoma procesami. Nazwa nigdy nie jest lokalizowana przypadkowo. Szkolenie trwa jeden kliknięcie, odbywa się na twoim sprzęcie, a nowy model jest gotowy do użycia po zakończeniu procesu.

Płacisz raz, posiadasz na zawsze

Kup je raz i będzie twoje. Licencja dożywotnia z rokiem aktualizacji w cenie.

Redukcja hałasu, tylko gdy jest to konieczne

Hałaśliwy pokój przestaje być problemem. Funkcja redukcji hałasu jest wbudowana – przydaje się podczas nagrywania w kawiarni, na targach lub w samochodzie. Domyślnie jest wyłączona, ponieważ przeprowadziliśmy pomiarы: przy krótkich, czystych nagraniach mikrofonem pogarsza jakość dźwięku. Podczas dwugodzinnego spotkania z ekspresem do kawy za plecami włącz tę funkcję.

Klawiatura, na której już piszesz

Klawiatura głosowa pisze tam, gdzie znajduje się kursor – w przeglądarce, IDE, aplikacji do czatowania, w dowolnym polu przyjmującym tekst wpisywany za pomocą klawiatury. Może również wpisywać tłumaczenie zamiast transkrypcji. Wypowiedz zdanie w swoim języku, a odpowiednie słowa pojawią się w formularzu w języku, którego ten wymaga. Jeden wiersz, bez kopiowania i wklejania.

Dwa rozmiary, Twój wybór

0,6 B to model do codziennego użytku. Działa na każdej karcie graficznej o pojemności 4 GB, na kartach graficznych wbudowanych oraz w laptopach bez karty graficznej. Szybki, lekki – zawsze dostępny, gdy go potrzebujesz.

1,7 miliarda

Duży · Vulkan / CPU
~2–3 GB

Żadnej karty graficznej w ogóle? Nadal działa. Wersja działająca wyłącznie na procesorze wymaga 8 GB pamięci RAM, procesora czterordzeniowego oraz około 5 GB wolnego miejsca na dysku; wszystko inne potrzebuje od 7 do 9 GB. Wystarczy każda karta z obsługą Vulkan 1.2+ – NVIDIA, AMD, Intel Arc. Transkrypcja i tłumaczenie korzystają z oddzielnych procesorów, więc jedno może działać na karcie graficznej, a drugie na procesorze.

Dodatkowe moduły pobierane na żądanie z Ustawienia → Modele:

Forced Aligner (~540 MB) dla znaczników czasu na poziomie słów · Hunyuan MT2 Fast (~1 GB) lub Jakość (~4,3 GB) na potrzeby tłumaczenia.

Jak dokonujemy porównań

Funkcja Brethof Voice Pro Dragon Google STT Otter.ai Whisper (OSS)
100% przetwarzanie lokalne
Licencja dożywotnia ~
Natywna obsługa Linuxa ~
Natywna obsługa Windowsa ~ ~
30 języków ASR + automatyczne wykrywanie ~
Tłumaczenie offline (38 języków)
Przyspieszenie GPU (NVIDIA + AMD + Intel) N/A N/A ~
Doprecyzowanie modelu osobistego (LoRA)
Serwer MCP dla agentów AI
Wbudowana funkcja redukcji szumów
Bezpośrednia iniekcja tekstu
Dopracowany interfejs graficzny desktopowy
Typowy koszt $49 kiedyś 350 USD/rok 17 USD/mies. 17 USD/mies. Darmowy

Płatność raz. Własność na zawsze.

Brak opłat miesięcznych. Brak ograniczeń korzystania. Licencja wieczysta z 1 rokiem aktualizacji w cenie.

Bezpłatny okres próbny
$ 0

Nie jest wymagana karta kredytowa. Wystarczy e-mail w celu weryfikacji okresu próbnego.

  • Obie wielkości modeli (0,6 mld + 1,7 mld)
  • Przyspieszenie GPU
  • 30 ASR + 38 języków tłumaczenia
  • Redukcja szumów
  • × Brak indywidualnego trenowania (tylko plany płatne)
  • × Brak serwera MCP (tylko plany płatne)
  • × 14-dniowy limit
Rozpocznij bezpłatną próbę
Business
$ 249 /użytkownika

Licencja wieczysta (na użytkownika). Do użytku zespołów i organizacji. 1 rok aktualizacji.

  • Licencja wieczysta (na użytkownika)
  • Użycie przez zespoły i organizacje
  • Obie wersje ASR (0,6 mld + 1,7 mld)
  • Tłumaczenie offline (38 języków)
  • Osobiste szkolenie głosu (LoRA)
  • Serwer MCP dla agentów AI
  • Priorytetowe wsparcie
  • Zniżki hurtowe (10+ miejsc)
Kup licencję biznesową

Ceny bez podatku. Następnie 20 USD/użytkownika/rok za aktualizacje (opcjonalnie)

Często zadawane pytania

Nie. Brethof Voice Pro przetwarza wszystko lokalnie na Twoim urządzeniu. Żadne dane audio ani tekstowe nie opuszczają Twojego komputera. Nie ma komponentu chmurowego, żadnej telemetrii ani analizy danych.

Wystarczy dowolna nowoczesna karta graficzna. NVIDIA, AMD oraz Intel Arc wykorzystują przyspieszenie Vulkan. Można również korzystać wyłącznie z procesora CPU, choć transkrypcja będzie wolniejsza. Model o pojemności 0,6 miliarda parametrów działa sprawnie zarówno z grafiką wbudowaną, jak i z dowolną kartą graficzną obsługującą Vulkan o pojemności co najmniej 4 GB.

Zacznij od Model 0,6B — Jest to zalecana wartość domyślna i działa doskonale na większości kart graficznych (a nawet na procesorze w większości nowoczesnych komputerów). Jeśli potrzebujesz wyższej dokładności przy dźwięku z akcentami lub z szumem, przejdź na Model 1,7B (wymaga 6 GB+ VRAM). Możesz zmieniać rozmiary w Ustawienia → Modele bez ponownego pobierania.

Tak. Brethof Voice Pro obsługuje zarówno Linux, jak i Windows w sposób natywny. Na Linuxie działa z X11 i Wayland. Na Windowsie funkcjonuje jako standardowa aplikacja desktopowa.

Twoja licencja jest dożywotnia – aplikacja będzie działać wiecznie z dowolną posiadaną przez Ciebie wersją. Opcjonalny abonament Update Pass w cenie 20 USD/rok daje dostęp do nowych funkcji i ulepszeń modeli. Bez niego pozostajesz przy obecnej wersji.

Tak — trening głosu osobistego jest już dostępny w wersji v2.0.0 i odbywa się w całości na twoim komputerze. Za każdym razem, gdy poprawiasz błędnie rozpoznane słowo, para {clip, correction} jest automatycznie zapisywana do twojego lokalnego zestawu danych treningowych. Karta treningu w głównym oknie pokazuje od razu łączną liczbę próbek oraz minut nagrań — kliknij „Start training” na karcie Training, aby dostosować model LoRA do twojego akcentu. Wynik jest automatycznie eksportowany w formacie GGUF, który można szybko otworzyć jednym kliknięciem. Dostępny bezpłatnie przy każdej licencji płatnej, twoje dane głosowe nigdy nie opuszczają twojego komputera.

Gotowy, by to wypróbować?

14-dniowy bezpłatny okres próbny. Bez karty kredytowej. Bez chmury. Bez kompromisów.

Usłyszysz, gdy się ukaże

Nowe wydania, prawdziwe benchmarki i okazjonalne dogłębne analizy. Bez spamu, rezygnacja jednym kliknięciem.

Wszystko, co tworzymy

Voice Pro

Lokalna konwersja mowy na tekst, która uczy się Twojego głosu. Licencja dożywotnia. Nasz flagowy produkt.

Płatny · flagowy

brethof-brain

Pamięć długoterminowa dla twoich agentów AI — tekst pełny + wektory + grafy. Informacje są przekazywane na początku sesji, przywoływane przy każdym zapytaniu i automatycznie archiwizowane.

Opłacone · plan bezpłatny

Modele 3D

Gotowe do druku modele cyfrowe. Zawiera GLB i OBJ. Dostęp dożywotni.

Płatny · katalog cyfrowy

Druk 3D

Pięć drukarek o rzeczywistej mocy. Jeszcze nie ma sklepu samoobsługowego — podaj nam, czego potrzebujesz, a prześlemy wycenę e-mailem.

Za umową · napisz do nas e-mailem

Nova

Nasz kanał na YouTube. Prezenter w postaci cybertygrysa opisuje lokalne narzędzia AI i to, do czego faktycznie służą.

KANAŁ · transmisja na żywo

Świetne listy

Wyselekcjonowane listy na GitHubie dla agentów do programowania w obszarze sztucznej inteligencji, serwerów MCP, lokalnych rozwiązań opartych na sztucznej inteligencji oraz Linuxa do zastosowań w tej dziedzinie. Każda pozycja zawiera link do źródła.

BEZPŁATNE · starannie wybrane

Przewodniki

Szczegółowe instrukcje dotyczące lokalnego AI na Linux, Windows i macOS, wraz z plikami konfiguracyjnymi.

BEZPŁATNE · na żywo

Lista rankingowa anty-dev

Negatywna kuracja: praktyki i narzędzia, które marnują Twój czas, sklasyfikowane. Dowody wymagane.

BEZPŁATNE · na żywo

O Brethof AI

Kim jesteśmy, dlaczego tworzymy sztuczną inteligencję skupioną na prywatności i czego nie zrobimy.

Zewnętrzne: YouTube · GitHub