Rozmawiasz. Słowa trafiają – do twojego edytora, terminala, okna czatu, formularza, wszędzie tam, gdzie znajduje się kursor. I każde z nich pozostaje na komputerze, na którym je wypowiedziałeś.
Brethof Voice Pro to narzędzie do konwersji mowy na tekst oraz tłumaczenia, które działa wyłącznie na twoim komputerze. To nie jest funkcja związana z ochroną prywatności – to sama istota tego produktu.
Jeden program, praca czterech osób. Transkrybuje twój głos, tłumaczy go na 38 języków, dodaje napisy do twoich filmów oraz pisze za ciebie tam, gdzie jest klawiatura. Działa offline – w samolocie, w hotelu z słabym Wi-Fi, w tunelu – oraz na laptopie, który już posiadasz, z kartą graficzną lub bez niej. Brak subskrypcji. Brak opłat za minutę. Brak konieczności przesyłania danych. Daj też swojemu agentowi AI uszy: może on transkrybować, tłumaczyć i nagrywać spotkania dowolnej długości za pośrednictwem MCP, na twoim urządzeniu, bez klucza API. Kup go raz i będzie działał bez przerwy.
Twój głos nigdy nie opuszcza twojego komputera. To zdanie jest precyzyjne i oddaje istotę sprawy. Podczas uruchamiania do sieci trafiają tylko trzy rzeczy: sprawdzenie licencji, sprawdzenie aktualizacji oraz modele, które sam pobierasz. Sprawdzenie licencji wysyła klucz licencyjny, a sprawdzenie aktualizacji – ciąg znaków wskazujący wersję – nigdy żadnego dźwięku ani tekstu. Wyłącz sprawdzenie aktualizacji, a gdy modele znajdą się na dysku, nic już nie zostanie wysłane.
Transkrypcja w ponad 30 językach, a 22 chińskie dialekty regionalne są rozumiane automatycznie – bez konfiguracji, bez szkolenia. Twoje akcenty przestaną być błędnie interpretowane. Brethof Voice Pro uczy się twojego głosu, specjalistycznej terminologii oraz nazw własnych na twoim własnym urządzeniu. Mów po syczuańsku jak twoja babcia – wszystko będzie brzmieć poprawnie.
Mów po polsku, czytaj po angielsku. Mów po angielsku, czytaj po japońsku. Albo powiedz to raz, a tekst zostanie wpisany jednocześnie po angielsku, japońsku, francusku i hiszpańsku – po jednym w linii lub obok siebie w tej samej linii. Wybierz tyle języków docelowych, ile chcesz; jest ich 38, a 23 działają w obu kierunkach. Tłumaczenie odbywa się również na twoim komputerze, za pomocą systemu Hunyuan MT2 firmy Tencent. Przy takiej jakości osiąga 97,9% wyniku systemu Gemini 3.1 Pro firmy Google w teście FLORES-200, a przewyższa go przy tłumaczeniach w rzeczywistym świecie oraz językach mniejszościowych. Dostępne są dwa warianty rozdzielczości, oba do pobrania opcjonalnie: szybszy do codziennego użytku, wysokiej jakości dla ważniejszych tekstów. Dostępne są również napisy – w formie tekstu prostego lub SRT, z synchronizacją według zdań lub słów, gdy potrzebujesz dokładnej edycji. Tłumacząc plik z napisami, cała synchronizacja zostaje zachowana. Dodaj napisy do swojego filmu w 38 językach bez płacenia za każdą minutę.
Dlatego działa tam, gdzie nic innego nie zadziała. Samolot. Hotel z kiepskim Wi-Fi. Pociąg jadący przez tunel. Nie ma dokąd trafić nagraniu, więc nie musi nigdzie iść. Wgraj nagranie dwugodzinnego spotkania i idź zaparzyć kawę; transkrypcja będzie już gotowa, gdy wrócisz. Zapomnij, że włączyłeś nagrywanie – nic się nie straci; urządzenie samo dokończy pracę i zachowa transkrypcję.
Dwa modele transkrypcji, i to jest wybór, a nie poziom – możesz je zmieniać w dowolnym momencie.
Większość oprogramowania do przetwarzania mowy wymaga od użytkownika odczytywania przykładowych zdań podczas konfiguracji. To oprogramowanie tak nie robi. Uczy się na podstawie korekt, które już wprowadzasz: poprawiasz błędnie usłyszane słowo, a ta korekta staje się przykładem do szkolenia. Po raz jedyny ustaw swoje nazwy firmowe, żargon oraz imiona kolegów – wtedy przestaną pojawiać się błędnie, zarówno w transkrypcji, jak i w tłumaczeniu, ponieważ ta sama lista steruje obydwoma procesami. Nazwa nigdy nie jest lokalizowana przypadkowo. Szkolenie trwa jeden kliknięcie, odbywa się na twoim sprzęcie, a nowy model jest gotowy do użycia po zakończeniu procesu.
Kup je raz i będzie twoje. Licencja dożywotnia z rokiem aktualizacji w cenie.
Hałaśliwy pokój przestaje być problemem. Funkcja redukcji hałasu jest wbudowana – przydaje się podczas nagrywania w kawiarni, na targach lub w samochodzie. Domyślnie jest wyłączona, ponieważ przeprowadziliśmy pomiarы: przy krótkich, czystych nagraniach mikrofonem pogarsza jakość dźwięku. Podczas dwugodzinnego spotkania z ekspresem do kawy za plecami włącz tę funkcję.
Klawiatura głosowa pisze tam, gdzie znajduje się kursor – w przeglądarce, IDE, aplikacji do czatowania, w dowolnym polu przyjmującym tekst wpisywany za pomocą klawiatury. Może również wpisywać tłumaczenie zamiast transkrypcji. Wypowiedz zdanie w swoim języku, a odpowiednie słowa pojawią się w formularzu w języku, którego ten wymaga. Jeden wiersz, bez kopiowania i wklejania.
0,6 B to model do codziennego użytku. Działa na każdej karcie graficznej o pojemności 4 GB, na kartach graficznych wbudowanych oraz w laptopach bez karty graficznej. Szybki, lekki – zawsze dostępny, gdy go potrzebujesz.
Wersja 1,7 miliarda to ta bardziej precyzyjna – nadaje się do audio z akcentami, hałaśliwego audio, a także podczas dwugodzinnych spotkań, gdzie znaczenie mają słowa. Wymaga około 6 GB pamięci VRAM, lub 8 GB, jeśli jednocześnie zostanie załadowany model tłumaczenia o wyższej jakości.
Żadnej karty graficznej w ogóle? Nadal działa. Wersja działająca wyłącznie na procesorze wymaga 8 GB pamięci RAM, procesora czterordzeniowego oraz około 5 GB wolnego miejsca na dysku; wszystko inne potrzebuje od 7 do 9 GB. Wystarczy każda karta z obsługą Vulkan 1.2+ – NVIDIA, AMD, Intel Arc. Transkrypcja i tłumaczenie korzystają z oddzielnych procesorów, więc jedno może działać na karcie graficznej, a drugie na procesorze.
Dodatkowe moduły pobierane na żądanie z Ustawienia → Modele:
Forced Aligner (~540 MB) dla znaczników czasu na poziomie słów · Hunyuan MT2 Fast (~1 GB) lub Jakość (~4,3 GB) na potrzeby tłumaczenia.
| Funkcja | Brethof Voice Pro | Dragon | Google STT | Otter.ai | Whisper (OSS) |
|---|---|---|---|---|---|
| 100% przetwarzanie lokalne | ✓ | ✓ | ✗ | ✗ | ✓ |
| Licencja dożywotnia | ✓ | ~ | ✗ | ✗ | ✓ |
| Natywna obsługa Linuxa | ✓ | ✗ | ~ | ✗ | ✓ |
| Natywna obsługa Windowsa | ✓ | ✓ | ~ | ✗ | ~ |
| 30 języków ASR + automatyczne wykrywanie | ✓ | ✗ | ✓ | ~ | ✓ |
| Tłumaczenie offline (38 języków) | ✓ | ✗ | ✗ | ✗ | ✗ |
| Przyspieszenie GPU (NVIDIA + AMD + Intel) | ✓ | ✗ | N/A | N/A | ~ |
| Doprecyzowanie modelu osobistego (LoRA) | ✓ | ✓ | ✗ | ✗ | ✗ |
| Serwer MCP dla agentów AI | ✓ | ✗ | ✗ | ✗ | ✗ |
| Wbudowana funkcja redukcji szumów | ✓ | ✓ | ✓ | ✓ | ✗ |
| Bezpośrednia iniekcja tekstu | ✓ | ✓ | ✗ | ✗ | ✗ |
| Dopracowany interfejs graficzny desktopowy | ✓ | ✓ | ✗ | ✓ | ✗ |
| Typowy koszt | $49 kiedyś | 350 USD/rok | 17 USD/mies. | 17 USD/mies. | Darmowy |
Brak opłat miesięcznych. Brak ograniczeń korzystania. Licencja wieczysta z 1 rokiem aktualizacji w cenie.
Nie jest wymagana karta kredytowa. Wystarczy e-mail w celu weryfikacji okresu próbnego.
Licencja dożywotnia. 2 urządzenia osobiste. W cenie 1 rok aktualizacji.
Ceny bez podatku. Następnie 20 USD rocznie za aktualizacje (opcjonalne)
Licencja wieczysta (na użytkownika). Do użytku zespołów i organizacji. 1 rok aktualizacji.
Ceny bez podatku. Następnie 20 USD/użytkownika/rok za aktualizacje (opcjonalnie)
Nie. Brethof Voice Pro przetwarza wszystko lokalnie na Twoim urządzeniu. Żadne dane audio ani tekstowe nie opuszczają Twojego komputera. Nie ma komponentu chmurowego, żadnej telemetrii ani analizy danych.
Wystarczy dowolna nowoczesna karta graficzna. NVIDIA, AMD oraz Intel Arc wykorzystują przyspieszenie Vulkan. Można również korzystać wyłącznie z procesora CPU, choć transkrypcja będzie wolniejsza. Model o pojemności 0,6 miliarda parametrów działa sprawnie zarówno z grafiką wbudowaną, jak i z dowolną kartą graficzną obsługującą Vulkan o pojemności co najmniej 4 GB.
Zacznij od Model 0,6B — Jest to zalecana wartość domyślna i działa doskonale na większości kart graficznych (a nawet na procesorze w większości nowoczesnych komputerów). Jeśli potrzebujesz wyższej dokładności przy dźwięku z akcentami lub z szumem, przejdź na Model 1,7B (wymaga 6 GB+ VRAM). Możesz zmieniać rozmiary w Ustawienia → Modele bez ponownego pobierania.
Tak. Brethof Voice Pro obsługuje zarówno Linux, jak i Windows w sposób natywny. Na Linuxie działa z X11 i Wayland. Na Windowsie funkcjonuje jako standardowa aplikacja desktopowa.
Twoja licencja jest dożywotnia – aplikacja będzie działać wiecznie z dowolną posiadaną przez Ciebie wersją. Opcjonalny abonament Update Pass w cenie 20 USD/rok daje dostęp do nowych funkcji i ulepszeń modeli. Bez niego pozostajesz przy obecnej wersji.
Tak — trening głosu osobistego jest już dostępny w wersji v2.0.0 i odbywa się w całości na twoim komputerze. Za każdym razem, gdy poprawiasz błędnie rozpoznane słowo, para {clip, correction} jest automatycznie zapisywana do twojego lokalnego zestawu danych treningowych. Karta treningu w głównym oknie pokazuje od razu łączną liczbę próbek oraz minut nagrań — kliknij „Start training” na karcie Training, aby dostosować model LoRA do twojego akcentu. Wynik jest automatycznie eksportowany w formacie GGUF, który można szybko otworzyć jednym kliknięciem. Dostępny bezpłatnie przy każdej licencji płatnej, twoje dane głosowe nigdy nie opuszczają twojego komputera.
14-dniowy bezpłatny okres próbny. Bez karty kredytowej. Bez chmury. Bez kompromisów.
Lokalna konwersja mowy na tekst, która uczy się Twojego głosu. Licencja dożywotnia. Nasz flagowy produkt.
Płatny · flagowy
Pamięć długoterminowa dla twoich agentów AI — tekst pełny + wektory + grafy. Informacje są przekazywane na początku sesji, przywoływane przy każdym zapytaniu i automatycznie archiwizowane.
Opłacone · plan bezpłatny
Gotowe do druku modele cyfrowe. Zawiera GLB i OBJ. Dostęp dożywotni.
Płatny · katalog cyfrowy
Pięć drukarek o rzeczywistej mocy. Jeszcze nie ma sklepu samoobsługowego — podaj nam, czego potrzebujesz, a prześlemy wycenę e-mailem.
Za umową · napisz do nas e-mailem
Nasz kanał na YouTube. Prezenter w postaci cybertygrysa opisuje lokalne narzędzia AI i to, do czego faktycznie służą.
KANAŁ · transmisja na żywo
Wyselekcjonowane listy na GitHubie dla agentów do programowania w obszarze sztucznej inteligencji, serwerów MCP, lokalnych rozwiązań opartych na sztucznej inteligencji oraz Linuxa do zastosowań w tej dziedzinie. Każda pozycja zawiera link do źródła.
BEZPŁATNE · starannie wybrane
Szczegółowe instrukcje dotyczące lokalnego AI na Linux, Windows i macOS, wraz z plikami konfiguracyjnymi.
BEZPŁATNE · na żywo
Negatywna kuracja: praktyki i narzędzia, które marnują Twój czas, sklasyfikowane. Dowody wymagane.
BEZPŁATNE · na żywo
Kim jesteśmy, dlaczego tworzymy sztuczną inteligencję skupioną na prywatności i czego nie zrobimy.