Brethof Voice Pro — Co nowego

Aktualna historia tej aplikacji, wraz z każdym nowym wydaniem. Jeśli masz najnowszą wersję, to jest lista tego, co już posiadasz – a notatki poniżej zestawienia zmian wyjaśniają decyzje podjęte przy niektórych z nich.

Wydanie 14 sierpnia 2026 roku

v2.3.1 — konta dwufaktorowe mogą ponownie się zalogować

W poprzedniej wersji doszło do błędu, który uniemożliwił kontom z dwuetapową autoryzacją logowanie się. Wersja 2.3.1 to naprawia. Jeśli to dotyczy Ciebie: wprowadź swoje dane logowania oraz kod, a będziesz już w środku. Nic innego się nie zmieniło.

Wydanie 6 sierpnia 2026 roku

v2.2.2 — pliki napisów, mniej więcej dwa razy szybciej

Tłumaczenie pliku napisów zajmuje teraz mniej więcej połowę czasu wcześniej. Czas przetwarzania pozostaje niezmieniony – każda data i godzina pojawiają się dokładnie w tym samym miejscu co w oryginale, niezależnie od tego, czy chcesz tłumaczenie na poziomie zdań, czy słów. Jeśli zajmujesz się tłumaczeniem napisów jako zawód, to właśnie w tej wersji czas oczekiwania znacznie się skrócił.

Również w wersji 2.2.2:

  • Poprawiono wejście mikrofonowe – co było najważniejsze przy dobrych mikrofonach. Niwelowanie dźwięku może sprawić, że najgłośniejsze momenty czystego nagrania przekroczą maksymalny poziom i ulegną przycięciu. Im lepszy jest mikrofon, tym większa jest różnica pomiędzy jego szczytami a średnim poziomem, co zwiększa ryzyko takiego efektu – skompresowany, hałaśliwy sygnał przechodzi bez zmian, natomiast cichy pomieszczenie oraz przyzwoity mikrofon kondensatorowy ulegają uszkodzeniu. Dzięki niwelowaniu pozostaje zapas mocy, dzięki czemu spółgłoski i gwałtowne transze dźwięku zachowują się nienaruszone.
  • Nowy translate_batch Narzędzie MCP — Tłumacz wiele ciągów znaków w jednym wywołaniu, z parametrem rozmiaru partii, który automatycznie się wycofuje, gdy zabraknie pamięci VRAM.
Pobierz wersję 2.2.2 →
Wydanie 11 lipca 2026 roku

v2.2.1 — aplikacja, którą posiadasz, pozostaje twoja

Brethof Voice Pro staje się twoim, gdy go kupisz, a wersja 2.2.1 zapewnia, że nic nie stanie na drodze między tobą a nim. Wcześniej kontrola licencji przy uruchamianiu funkcjonowała jak bariera: brak połączenia sieciowego, zajęty serwer, firewall odrzucający próbę – to wszystko mogło uniemożliwić dostęp do oprogramowania, za które zapłaciłeś. Teraz ta kontrola nie stanowi przeszkody – jeśli nie można nawiązać połączenia, aplikacja i tak się uruchomi. Oprogramowanie, które jest twoje, nie powinno prosić o zgodę na uruchomienie. Już tego nie robi.

  • Przeczyść licencję w oknie dialogowym licencji — wymusza świeże sprawdzenie i Continue wydaje nowe wersje w przypadku sukcesu. Wcześniej jedynymi wyjściami były zakup lub rezygnacja.
  • Brak oznaczeń wygasających okresu próbnego dla klientów płatnych — Dialogi teraz pokazują to, co naprawdę się stało, zamiast wyświetlać wszystkim tę samą wiadomość.
  • Brak dalszych zamarznięć interfejsu. — Pobieranie modeli odbywa się w tle na wątku interfejsu z pokazaniem procentu postępu, a sprawdzanie licencji przy uruchamianiu nie blokuje już okna przy wolnym połączeniu.
  • Brak utraconych dyktandów — Jeśli transkrypcja nadal jest w trakcie przy nagrywaniu, nowy dźwięk zostaje umieszczony w kolejce, zamiast zostać bez echa odrzucony, a zablokowany proces nie może już wpisywać późniejszego tekstu do następnego nagrania.
  • Bez połączenia jest cicho — Brak powtarzających się oczekiwań sieciowych, gdy nie ma połączenia.
Pobierz →
Wydanie 4 czerwca 2026 roku

v2.2.0 — nagrywać całe spotkanie, a nie pierwsze pięć minut

Długie nagrania są teraz przetwarzane w tle. Podaj plik z nagraniem trwającym dwie godziny i idź zaparzyć kawę – nie ma żadnego ograniczenia co do długości, a nie trzeba niczego monitorować. Pozostaw to w działaniu i zapomnij o tym; nagranie zostanie ukończone samo i zachowa dla ciebie transkrypcję. Rozmowa trwająca trzy godziny nie różni się od tej trwającej trzy minuty; po prostu zajmuje więcej czasu.

  • Mikrofon lub dźwięk systemu — Nagraj własny głos lub przechwyć przez loopback to, co jest odtwarzane na Twoim komputerze: rozmowy ze spotkań, karty przeglądarki, cokolwiek z głośników. Nowość list_loopback_sources Narzędzie do sprawdzenia, co jest dostępne.
  • Nic nie jest wyrzucane. — Jeśli nagranie zostanie porzucone, watchdog przekształca je teraz w zadanie dostępne do odzyskania, zamiast je wyrzucić.
  • Uczciwe granice — Krótki tryb transkrypcji natychmiastowej został podniesiony do limitu 10 minut, a żądanie więcej, niż może pomieścić, zwraca teraz wyraźny błąd wskazujący na narzędzie do długich form. Program nie przycina już po cichu Twojego dźwięku i nie zwraca częściowej odpowiedzi.
  • Poprawka tłumaczenia Linuxa — Brakująca zależność spowodował awarię tłumaczenia we wszystkich wersjach Linux od wersji 1.7.0. Zostało to odkryte dzięki nowej bramie kontrolnej typu end-to-end, która sprawdza rzeczywisty plik binarny przed każdym wydaniem.
Pobierz →
Aktualizacja 4 czerwca 2026 roku

v2.1.0 — twój agent otrzymuje dostęp przez HTTP

Agent na tej samej maszynie może teraz korzystać z Brethof Voice Pro – do transkrypcji, tłumaczenia, nagrywania – za pośrednictwem MCP. Działa przez lokalny HTTP, więc agent, który może uzyskać dostęp tylko poprzez adres URL, może go używać bez klucza API i bez wydostawania się czegokolwiek poza maszynę. Token chroni dostęp, a serwer odmawia uruchomienia bez niego. Ten wariant wymaga płatnej licencji.

  • Domyślnie prywatne — Słucha tylko na twoim własnym komputerze, chyba że celowo to zmienisz, i to ograniczenie jest większe. odmawia uruchomienia bez tokena uwierzytelniającego. Gdy token jest ustawiony, każde żądanie musi go przedstawić.
  • Praca bez przerw — Modele, które mogą zostać wyłączone w stanie bezczynności, nie mogą już być wyłączane w trakcie długiego zadań. Czas oczekiwania, który ignoruje prace trwające, ostatecznie może zakończyć działanie czegoś ważnego, dlatego zegar bezczynności jest teraz wstrzymywany, dopóki coś się uruchomione jest.
Pobierz →
Wydanie 21 maja 2026

v2.0.0 — tłumaczenie, które nigdy nie wychodzi z domu

Najlepsza opcja. Tłumaczenie odbywa się w całości na twoim urządzeniu, dostępne w 38 językach. Wystarczy raz powiedzieć tekst, a on zostanie wpisany jednocześnie po angielsku, japońsku, francusku i hiszpańsku – po jednym wierszu lub obok siebie w tym samym wierszu. Silnikiem jest Hunyuan MT2 firmy Tencent, dostępny w dwóch wersjach: szybka do codziennego użytku oraz wysokiej jakości do zadań wymagających dokładności. Według oficjalnych pomiarów firmy Tencent, wersja o wysokiej jakości osiąga 97,9% wyników Google Gemini 3.1 Pro w teście FLORES-200, przewyższając go również przy tłumaczeniach w rzeczywistych warunkach oraz w językach mniejszościowych. Wszystko to działa offline – żadne dane nie są wysyłane nigdzie indziej.

Co nowego w wersji 2.0.0:

  • Transkrypcja i tłumaczenie — okno Transcribe zawiera rozwijane menu „Tłumacz na:”. ASR transkrybuje, MT tłumaczy, oba renderowane są obok siebie. Działa z plikami, mikrofonem i dźwiękiem systemowym (loopback, czyli przechwytywanie rozmów, kart przeglądarki, czegokolwiek odtwarzanego na głośnikach).
  • Wielojęzyczna klawiatura głosowa — Nowy przycisk tłumaczenia w głównym wierszu otwiera 3-kolumnową siatkę językową. Wybierz jeden lub więcej języków docelowych, a klawiatura wpisze tłumaczenie. Tryby układu: jedna linia na tekst, inline (EN: … || PL: …), lub tylko pierwszy język docelowy.
  • Tłumacz napisów SRT / VTT — zachowuje czasy i indeksy cue, obsługuje tryb dwujęzyczny (linia źródłowa + tłumaczenie dla każdego cue). Udostępnione przez MCP dla automatyzacji agentów AI.
  • Wielokrotne GPU na silnik — Ustawienia → Modele zawierają niezależny wybieracz urządzeń dla każdego silnika. Uruchom ASR na Vulkan 0, a tłumaczenie na Vulkan 1, albo przypnij Hunyuan MT2 7B do CPU w laptopach z ograniczoną pamięcią VRAM.
  • Trening głosu osobistego jest w pełni dostępny — Fine-tuning LoRA na twoim własnym głosie, w całości na twoim komputerze. Karta treningu w głównym oknie pokazuje na pierwszy rzut oka łączną liczbę próbek oraz minut nagrania; opcja „Rozpocznij trening” w karcie Trening automatycznie wybiera NVIDIA CUDA lub CPU, a następnie automatycznie eksportuje wytrenowany model do formatu GGUF. Dostępne bezpłatnie przy każdej płatnej licencji.
  • 4 nowe narzędzia MCPtranslate_text, translate_srt, list_compute_devices, set_compute_device. Łączna liczba narzędzi wynosi teraz 19.
  • Szczere podziały językowe — ASR: 30 języków do wyboru + automatyczne wykrywanie + 22 dialekty chińskie (łącznie 52). Tłumaczenie: 38 języków (33 główne + 5 języków mniejszości z regionów chińskich). 23 obsługują tłumaczenie dwukierunkowe.

Binarny plik Linux ma rozmiar 161 MB, instalator Windows – 118 MB. Istniejące licencje są przenoszone – wystarczy pobierz v2.0.0 a modele tłumaczeniowe pojawią się w Ustawieniach → Modele.

Pobierz wersję 2.0.0 →
Wydanie 20 maja 2026

v1.6.16 — twój głos staje się własnym modelem

Brethof Voice Pro teraz trenuje się na twoim głosie. Danymi treningowymi są korekty, które już wprowadzasz – poprawiasz błędnie usłyszane słowo raz, a to staje się przykładem. Nigdy nie proszono cię o czytanie zdań przykładowych. Trening zajmuje jedno kliknięcie, odbywa się na twoim sprzęcie, a po zakończeniu nowy model jest gotowy do użycia.

Ta wersja odblokowuje wszystko z wyjątkiem treningów osobistych i połączenia z agentem; ta opcja jest przeznaczona dla osób, które korzystają z aplikacji codziennie.

Inżynieria 15 maja 2026

v1.6.0 — uruchom to, wróć później

Dwie rzeczy. Transkrypcja może teraz być wykonywana jako zadanie asynchroniczne — wgraj dźwięk, odbierz transkrypcję po zakończeniu, nie musisz siedzieć przy tym cały czas.

A czas wyświetlania napisów: teraz możesz ustalać czas dla poszczególnych słów zamiast dla całych zdań, w tych momentach, gdy potrzebujesz dokładnej edycji. Jeśli tworzysz napisy, już wiesz, dlaczego to ważne.

Inżynieria 15 maja 2026

v1.5.0 — jeden czas wykonywania, a ONNX zniknął

Silnik wykonywania ONNX już nie istnieje. Cały produkt teraz działa na llama.cpp oraz naszej własnej bibliotece tłumaczeniowej – jeden silnik wykonywania, mniejszy rozmiar na dysku, szybsze uruchamianie i łatwiejsza dystrybucja.

Modele to pojedyncze pliki GGUF, co umożliwia uruchomienie wersji małej na dowolnej karcie graficznej o pojemności 4 GB. Dłuższy wyjaśnienie powodów tej decyzji znajduje się niżej na stronie.

Inżynieria 14 maja 2026

v1.4.0 — pierwsze połączenie z agentem oraz narzędzie do wyboru GPU

Dwa pierwsze razy. Tutaj po raz pierwszy pojawia się serwer MCP – pierwszy sposób na nadanie agentowi „uszu”, i to wszystko na twoim własnym komputerze.

A także wybór urządzenia: transkrypcja i tłumaczenie mogą teraz wybrać własne procesory, dzięki czemu jedna może działać na karcie graficznej, podczas gdy druga pracuje na procesorze CPU. Laptop z przeciętną kartą graficzną może obsłużyć obie funkcje bez spowolnień.

Plan rozwoju 16 kwietnia 2026

macOS – w trakcie prac, najpierw dla Apple Silicon

macOS jest w fazie rozwoju, najpierw w wersji na chipach Apple Silicon. Nie ma jeszcze daty premiery, a my nie podamy żadnej, dopóki wersja gotowa nie zostanie stworzona. Tymczasem Linux i Windows to ten sam produkt z tymi samymi funkcjami – nic nie jest ukrywane w jednym, by sprzedać drugi. Gdy wersja dla Maca zostanie wydana, na tej stronie o tym będzie napisane.

Przeczytaj artykuł →
Produkt 16 kwietnia 2026

Szkol je na twoim własnym głosie

Twój akcent nie jest problemem, który trzeba obejść – to model, który można wyszkolić. Brethof Voice Pro uczy się na podstawie korekt, które już wprowadzasz: poprawiasz słowo niewłaściwie usłyszane raz, a ta korekta staje się przykładem do naśladowania. Żadnych zdań przykładowych, żadnego skryptu kalibracji, żadnej godziny czytania do mikrofonu. Słowa, które już ustaliłeś – nazwy marek, żargon, imiona kolegów – kierują zarówno transkrypcją, jak i tłumaczeniem, dzięki czemu imię nigdy nie zostanie przypadkowo przetłumaczone. Szkolenie zajmuje jeden kliknięcie, odbywa się na twoim sprzęcie, a nowy model jest gotowy do użycia po zakończeniu procesu. Korekty, które już wprowadzałeś, zawsze stanowiły materiał dydaktyczny. Teraz one szkolą model.

Przeczytaj artykuł →
Ogłoszenie 16 kwietnia 2026

Brethof Voice Pro jest już dostępny

Pierwsza wersja. Mów zamiast pisać, do czegokolwiek – do edytora, terminala, okna czatu, formularza – a słowa pojawią się tam, gdzie znajduje się kursor. Transkrypcja odbywa się wyłącznie na twoim komputerze, przy użyciu rozwiązania Qwen3-ASR firmy Alibaba w połączeniu z DeepFilterNet3 do usuwania szumów oraz Silero VAD do wykrywania głosu. Wszystko to działa lokalnie. Rozmowa z prawnikiem, nieukończony produkt, notatki o pacjencie – nic z tego nie opuszcza komputera, na którym zostało przetworzone, ponieważ nie ma dokąd pójść. Działa w samolocie, pociągu jadącym przez tunel, w hotelu z słabym Wi-Fi. Obsługuje trzydzieści języków, w tym 22 chińskie dialekty. Może być uruchomiony na laptopie, który już posiadasz – z kartą graficzną lub bez niej; jeśli jest karta, to dowolna karta GPU spełniająca standard Vulkan 1.2+ od NVIDIA, AMD lub Intel Arc. Na Linuxie dostępny jest jako jeden plik przenośny, wymaga glibc 2.38 lub nowszej, natomiast na Windows to zwykły program instalacyjny, który nie wymaga uprawnień administratora. Dostępna jest 14-dniowa wersja próbna – nie potrzeba karty, wystarczy adres e-mail.

Przeczytaj artykuł →
Licencjonowanie 16 kwietnia 2026

Twoja własna licencja obejmuje teraz twoją własną firmę.

Licencja indywidualna obejmuje teraz pracę samodzielnie oraz jako freelancer. Jeśli jesteś przedsiębiorcą indywidualnym, osobistym studiem lub wykonawcą, licencja, którą kupujesz, obejmuje twoją działalność. Brak rozliczania według liczby użytkowników, brak oddzielnego poziomu dla firm. Jedna licencja na dwa urządzenia, zakupiona raz. Dołączony jest rok aktualizacji; po tym okresie aktualizacje są opcjonalne, a aplikacja będzie nadal działać na Twojej obecnej wersji bez ograniczeń czasowych. Oprogramowanie, za które zapłaciłeś, pozostaje Twoje.

Przeczytaj artykuł →
Produkt 12 kwietnia 2026

Trzydzieści języków oraz interfejs użytkownika, który wygląda, jakby napisał go człowiek

Brethof Voice Pro umożliwia transkrypcję w 30 językach, rozpoznaje 22 regionalne dialekty chińskie oraz tłumaczy pomiędzy 38 językami. Interfejs jest w pełni przetłumaczony na wszystkie te 30 języków – tłumaczeniem zajęli się osoby korzystające z produktu, a nie maszynowe tłumaczenie. Możesz ustawić aplikację na swój język, a ona będzie wyglądać tak, jakby została napisana właśnie w tym języku, bo faktycznie tak jest.

Przeczytaj artykuł →
Inżynieria 8 kwietnia 2026

Dlaczego przeszliśmy z ONNX na GGUF

Pierwsze wersje aplikacji działały przy użyciu ONNX Runtime. To funkcjonowało, ale było to niewygodne, trudne do dystrybucji i sprawiało, że aplikacja była większa, niż to konieczne. Wersja v1.5.0 zastąpiła to pojedynczym środowiskiem działania – llama.cpp do transkrypcji oraz naszą własną biblioteką do tłumaczenia – a modele stały się pojedynczymi plikami w formacie GGUF. Efektem jest mniejszy rozmiar plików do pobrania, szybsze uruchamianie oraz aplikacja, która lepiej pasuje na laptopa. Istnieją dwa rozmiary modeli – jeden dla laptopów z grafiką wbudowaną, drugi dla materiałów audio z akcentami lub szumem. Można je zmieniać w dowolnym momencie, a jeśli nie chcesz, w ogóle nie potrzebujesz karty graficznej.

Przeczytaj artykuł →
Zasady 4 kwietnia 2026

Co dokładnie oznacza „100% offline”?

Trzy rzeczy docierają do sieci, i nic więcej. Sprawdzenie licencji podczas uruchamiania aplikacji. Sprawdzenie aktualizacji podczas uruchamiania aplikacji. I pobieranie modeli, które uruchamiasz samodzielnie. Sprawdzenie licencji wysyła klucz licencyjny; sprawdzenie aktualizacji wysyła ciąg wersji. Żadne z nich nie wysyła dźwięku ani tekstu, nigdy. Gdy modele znajdą się na dysku, a sprawdzenie aktualizacji zostanie wyłączone, nic już nie jest wysyłane. To nie jest stwierdzenie marketingowe – pokaże ci to dziennik firewalla. Powodem, dla którego wszystko powinno działać na twoim własnym komputerze, nie jest to, że chmura stanowi funkcję dodatkową. Chodzi o to, że twoje głos jest czymś, czego nie można cofnąć: rozmowa z prawnikiem, produkt jeszcze nieopublikowany, notatki o pacjencie. Narzędzie, które zajmuje się tymi rzeczami, nie powinno potrzebować połączenia sieciowego, aby wykonywać swoją pracę. Powinno działać nawet w samolocie i nie powinno umożliwiać wycieku informacji. To jest cała idea, a jest to decyzja projektowa, a nie funkcja dodatkowa.

Przeczytaj artykuł →

Otrzymuj aktualizacje w swojej skrzynce odbiorczej

Jeden e-mail na każdą wersję, z powyższym logiem zmian. Żadnego spamu, żadnych porad, żadnego cotygodniowego biuletynu. Anuluj subskrypcję jednym kliknięciem, w dowolnym momencie.

Utwórz konto

Usłyszysz, gdy się ukaże

Nowe wydania, prawdziwe benchmarki i okazjonalne dogłębne analizy. Bez spamu, rezygnacja jednym kliknięciem.

Wszystko, co tworzymy

Voice Pro

Lokalna konwersja mowy na tekst, która uczy się Twojego głosu. Licencja dożywotnia. Nasz flagowy produkt.

Płatny · flagowy

brethof-brain

Pamięć długoterminowa dla twoich agentów AI — tekst pełny + wektory + grafy. Informacje są przekazywane na początku sesji, przywoływane przy każdym zapytaniu i automatycznie archiwizowane.

Opłacone · plan bezpłatny

Modele 3D

Gotowe do druku modele cyfrowe. Zawiera GLB i OBJ. Dostęp dożywotni.

Płatny · katalog cyfrowy

Druk 3D

Pięć drukarek o rzeczywistej mocy. Jeszcze nie ma sklepu samoobsługowego — podaj nam, czego potrzebujesz, a prześlemy wycenę e-mailem.

Za umową · napisz do nas e-mailem

Nova

Nasz kanał na YouTube. Prezenter w postaci cybertygrysa opisuje lokalne narzędzia AI i to, do czego faktycznie służą.

KANAŁ · transmisja na żywo

Świetne listy

Wyselekcjonowane listy na GitHubie dla agentów do programowania w obszarze sztucznej inteligencji, serwerów MCP, lokalnych rozwiązań opartych na sztucznej inteligencji oraz Linuxa do zastosowań w tej dziedzinie. Każda pozycja zawiera link do źródła.

BEZPŁATNE · starannie wybrane

Przewodniki

Szczegółowe instrukcje dotyczące lokalnego AI na Linux, Windows i macOS, wraz z plikami konfiguracyjnymi.

BEZPŁATNE · na żywo

Lista rankingowa anty-dev

Negatywna kuracja: praktyki i narzędzia, które marnują Twój czas, sklasyfikowane. Dowody wymagane.

BEZPŁATNE · na żywo

O Brethof AI

Kim jesteśmy, dlaczego tworzymy sztuczną inteligencję skupioną na prywatności i czego nie zrobimy.

Zewnętrzne: YouTube · GitHub