Aktualna historia tej aplikacji, wraz z każdym nowym wydaniem. Jeśli masz najnowszą wersję, to jest lista tego, co już posiadasz – a notatki poniżej zestawienia zmian wyjaśniają decyzje podjęte przy niektórych z nich.
W poprzedniej wersji doszło do błędu, który uniemożliwił kontom z dwuetapową autoryzacją logowanie się. Wersja 2.3.1 to naprawia. Jeśli to dotyczy Ciebie: wprowadź swoje dane logowania oraz kod, a będziesz już w środku. Nic innego się nie zmieniło.
Tłumaczenie pliku napisów zajmuje teraz mniej więcej połowę czasu wcześniej. Czas przetwarzania pozostaje niezmieniony – każda data i godzina pojawiają się dokładnie w tym samym miejscu co w oryginale, niezależnie od tego, czy chcesz tłumaczenie na poziomie zdań, czy słów. Jeśli zajmujesz się tłumaczeniem napisów jako zawód, to właśnie w tej wersji czas oczekiwania znacznie się skrócił.
Również w wersji 2.2.2:
translate_batch Narzędzie MCP — Tłumacz wiele ciągów znaków w jednym wywołaniu, z parametrem rozmiaru partii, który automatycznie się wycofuje, gdy zabraknie pamięci VRAM.Brethof Voice Pro staje się twoim, gdy go kupisz, a wersja 2.2.1 zapewnia, że nic nie stanie na drodze między tobą a nim. Wcześniej kontrola licencji przy uruchamianiu funkcjonowała jak bariera: brak połączenia sieciowego, zajęty serwer, firewall odrzucający próbę – to wszystko mogło uniemożliwić dostęp do oprogramowania, za które zapłaciłeś. Teraz ta kontrola nie stanowi przeszkody – jeśli nie można nawiązać połączenia, aplikacja i tak się uruchomi. Oprogramowanie, które jest twoje, nie powinno prosić o zgodę na uruchomienie. Już tego nie robi.
Długie nagrania są teraz przetwarzane w tle. Podaj plik z nagraniem trwającym dwie godziny i idź zaparzyć kawę – nie ma żadnego ograniczenia co do długości, a nie trzeba niczego monitorować. Pozostaw to w działaniu i zapomnij o tym; nagranie zostanie ukończone samo i zachowa dla ciebie transkrypcję. Rozmowa trwająca trzy godziny nie różni się od tej trwającej trzy minuty; po prostu zajmuje więcej czasu.
list_loopback_sources Narzędzie do sprawdzenia, co jest dostępne.Agent na tej samej maszynie może teraz korzystać z Brethof Voice Pro – do transkrypcji, tłumaczenia, nagrywania – za pośrednictwem MCP. Działa przez lokalny HTTP, więc agent, który może uzyskać dostęp tylko poprzez adres URL, może go używać bez klucza API i bez wydostawania się czegokolwiek poza maszynę. Token chroni dostęp, a serwer odmawia uruchomienia bez niego. Ten wariant wymaga płatnej licencji.
Najlepsza opcja. Tłumaczenie odbywa się w całości na twoim urządzeniu, dostępne w 38 językach. Wystarczy raz powiedzieć tekst, a on zostanie wpisany jednocześnie po angielsku, japońsku, francusku i hiszpańsku – po jednym wierszu lub obok siebie w tym samym wierszu. Silnikiem jest Hunyuan MT2 firmy Tencent, dostępny w dwóch wersjach: szybka do codziennego użytku oraz wysokiej jakości do zadań wymagających dokładności. Według oficjalnych pomiarów firmy Tencent, wersja o wysokiej jakości osiąga 97,9% wyników Google Gemini 3.1 Pro w teście FLORES-200, przewyższając go również przy tłumaczeniach w rzeczywistych warunkach oraz w językach mniejszościowych. Wszystko to działa offline – żadne dane nie są wysyłane nigdzie indziej.
Co nowego w wersji 2.0.0:
EN: … || PL: …), lub tylko pierwszy język docelowy.translate_text, translate_srt, list_compute_devices, set_compute_device. Łączna liczba narzędzi wynosi teraz 19.Binarny plik Linux ma rozmiar 161 MB, instalator Windows – 118 MB. Istniejące licencje są przenoszone – wystarczy pobierz v2.0.0 a modele tłumaczeniowe pojawią się w Ustawieniach → Modele.
Pobierz wersję 2.0.0 →Brethof Voice Pro teraz trenuje się na twoim głosie. Danymi treningowymi są korekty, które już wprowadzasz – poprawiasz błędnie usłyszane słowo raz, a to staje się przykładem. Nigdy nie proszono cię o czytanie zdań przykładowych. Trening zajmuje jedno kliknięcie, odbywa się na twoim sprzęcie, a po zakończeniu nowy model jest gotowy do użycia.
Ta wersja odblokowuje wszystko z wyjątkiem treningów osobistych i połączenia z agentem; ta opcja jest przeznaczona dla osób, które korzystają z aplikacji codziennie.
Dwie rzeczy. Transkrypcja może teraz być wykonywana jako zadanie asynchroniczne — wgraj dźwięk, odbierz transkrypcję po zakończeniu, nie musisz siedzieć przy tym cały czas.
A czas wyświetlania napisów: teraz możesz ustalać czas dla poszczególnych słów zamiast dla całych zdań, w tych momentach, gdy potrzebujesz dokładnej edycji. Jeśli tworzysz napisy, już wiesz, dlaczego to ważne.
Silnik wykonywania ONNX już nie istnieje. Cały produkt teraz działa na llama.cpp oraz naszej własnej bibliotece tłumaczeniowej – jeden silnik wykonywania, mniejszy rozmiar na dysku, szybsze uruchamianie i łatwiejsza dystrybucja.
Modele to pojedyncze pliki GGUF, co umożliwia uruchomienie wersji małej na dowolnej karcie graficznej o pojemności 4 GB. Dłuższy wyjaśnienie powodów tej decyzji znajduje się niżej na stronie.
Dwa pierwsze razy. Tutaj po raz pierwszy pojawia się serwer MCP – pierwszy sposób na nadanie agentowi „uszu”, i to wszystko na twoim własnym komputerze.
A także wybór urządzenia: transkrypcja i tłumaczenie mogą teraz wybrać własne procesory, dzięki czemu jedna może działać na karcie graficznej, podczas gdy druga pracuje na procesorze CPU. Laptop z przeciętną kartą graficzną może obsłużyć obie funkcje bez spowolnień.
macOS jest w fazie rozwoju, najpierw w wersji na chipach Apple Silicon. Nie ma jeszcze daty premiery, a my nie podamy żadnej, dopóki wersja gotowa nie zostanie stworzona. Tymczasem Linux i Windows to ten sam produkt z tymi samymi funkcjami – nic nie jest ukrywane w jednym, by sprzedać drugi. Gdy wersja dla Maca zostanie wydana, na tej stronie o tym będzie napisane.
Przeczytaj artykuł →Twój akcent nie jest problemem, który trzeba obejść – to model, który można wyszkolić. Brethof Voice Pro uczy się na podstawie korekt, które już wprowadzasz: poprawiasz słowo niewłaściwie usłyszane raz, a ta korekta staje się przykładem do naśladowania. Żadnych zdań przykładowych, żadnego skryptu kalibracji, żadnej godziny czytania do mikrofonu. Słowa, które już ustaliłeś – nazwy marek, żargon, imiona kolegów – kierują zarówno transkrypcją, jak i tłumaczeniem, dzięki czemu imię nigdy nie zostanie przypadkowo przetłumaczone. Szkolenie zajmuje jeden kliknięcie, odbywa się na twoim sprzęcie, a nowy model jest gotowy do użycia po zakończeniu procesu. Korekty, które już wprowadzałeś, zawsze stanowiły materiał dydaktyczny. Teraz one szkolą model.
Przeczytaj artykuł →Pierwsza wersja. Mów zamiast pisać, do czegokolwiek – do edytora, terminala, okna czatu, formularza – a słowa pojawią się tam, gdzie znajduje się kursor. Transkrypcja odbywa się wyłącznie na twoim komputerze, przy użyciu rozwiązania Qwen3-ASR firmy Alibaba w połączeniu z DeepFilterNet3 do usuwania szumów oraz Silero VAD do wykrywania głosu. Wszystko to działa lokalnie. Rozmowa z prawnikiem, nieukończony produkt, notatki o pacjencie – nic z tego nie opuszcza komputera, na którym zostało przetworzone, ponieważ nie ma dokąd pójść. Działa w samolocie, pociągu jadącym przez tunel, w hotelu z słabym Wi-Fi. Obsługuje trzydzieści języków, w tym 22 chińskie dialekty. Może być uruchomiony na laptopie, który już posiadasz – z kartą graficzną lub bez niej; jeśli jest karta, to dowolna karta GPU spełniająca standard Vulkan 1.2+ od NVIDIA, AMD lub Intel Arc. Na Linuxie dostępny jest jako jeden plik przenośny, wymaga glibc 2.38 lub nowszej, natomiast na Windows to zwykły program instalacyjny, który nie wymaga uprawnień administratora. Dostępna jest 14-dniowa wersja próbna – nie potrzeba karty, wystarczy adres e-mail.
Przeczytaj artykuł →Licencja indywidualna obejmuje teraz pracę samodzielnie oraz jako freelancer. Jeśli jesteś przedsiębiorcą indywidualnym, osobistym studiem lub wykonawcą, licencja, którą kupujesz, obejmuje twoją działalność. Brak rozliczania według liczby użytkowników, brak oddzielnego poziomu dla firm. Jedna licencja na dwa urządzenia, zakupiona raz. Dołączony jest rok aktualizacji; po tym okresie aktualizacje są opcjonalne, a aplikacja będzie nadal działać na Twojej obecnej wersji bez ograniczeń czasowych. Oprogramowanie, za które zapłaciłeś, pozostaje Twoje.
Przeczytaj artykuł →Brethof Voice Pro umożliwia transkrypcję w 30 językach, rozpoznaje 22 regionalne dialekty chińskie oraz tłumaczy pomiędzy 38 językami. Interfejs jest w pełni przetłumaczony na wszystkie te 30 języków – tłumaczeniem zajęli się osoby korzystające z produktu, a nie maszynowe tłumaczenie. Możesz ustawić aplikację na swój język, a ona będzie wyglądać tak, jakby została napisana właśnie w tym języku, bo faktycznie tak jest.
Przeczytaj artykuł →Pierwsze wersje aplikacji działały przy użyciu ONNX Runtime. To funkcjonowało, ale było to niewygodne, trudne do dystrybucji i sprawiało, że aplikacja była większa, niż to konieczne. Wersja v1.5.0 zastąpiła to pojedynczym środowiskiem działania – llama.cpp do transkrypcji oraz naszą własną biblioteką do tłumaczenia – a modele stały się pojedynczymi plikami w formacie GGUF. Efektem jest mniejszy rozmiar plików do pobrania, szybsze uruchamianie oraz aplikacja, która lepiej pasuje na laptopa. Istnieją dwa rozmiary modeli – jeden dla laptopów z grafiką wbudowaną, drugi dla materiałów audio z akcentami lub szumem. Można je zmieniać w dowolnym momencie, a jeśli nie chcesz, w ogóle nie potrzebujesz karty graficznej.
Przeczytaj artykuł →Trzy rzeczy docierają do sieci, i nic więcej. Sprawdzenie licencji podczas uruchamiania aplikacji. Sprawdzenie aktualizacji podczas uruchamiania aplikacji. I pobieranie modeli, które uruchamiasz samodzielnie. Sprawdzenie licencji wysyła klucz licencyjny; sprawdzenie aktualizacji wysyła ciąg wersji. Żadne z nich nie wysyła dźwięku ani tekstu, nigdy. Gdy modele znajdą się na dysku, a sprawdzenie aktualizacji zostanie wyłączone, nic już nie jest wysyłane. To nie jest stwierdzenie marketingowe – pokaże ci to dziennik firewalla. Powodem, dla którego wszystko powinno działać na twoim własnym komputerze, nie jest to, że chmura stanowi funkcję dodatkową. Chodzi o to, że twoje głos jest czymś, czego nie można cofnąć: rozmowa z prawnikiem, produkt jeszcze nieopublikowany, notatki o pacjencie. Narzędzie, które zajmuje się tymi rzeczami, nie powinno potrzebować połączenia sieciowego, aby wykonywać swoją pracę. Powinno działać nawet w samolocie i nie powinno umożliwiać wycieku informacji. To jest cała idea, a jest to decyzja projektowa, a nie funkcja dodatkowa.
Przeczytaj artykuł →Jeden e-mail na każdą wersję, z powyższym logiem zmian. Żadnego spamu, żadnych porad, żadnego cotygodniowego biuletynu. Anuluj subskrypcję jednym kliknięciem, w dowolnym momencie.
Utwórz kontoLokalna konwersja mowy na tekst, która uczy się Twojego głosu. Licencja dożywotnia. Nasz flagowy produkt.
Płatny · flagowy
Pamięć długoterminowa dla twoich agentów AI — tekst pełny + wektory + grafy. Informacje są przekazywane na początku sesji, przywoływane przy każdym zapytaniu i automatycznie archiwizowane.
Opłacone · plan bezpłatny
Gotowe do druku modele cyfrowe. Zawiera GLB i OBJ. Dostęp dożywotni.
Płatny · katalog cyfrowy
Pięć drukarek o rzeczywistej mocy. Jeszcze nie ma sklepu samoobsługowego — podaj nam, czego potrzebujesz, a prześlemy wycenę e-mailem.
Za umową · napisz do nas e-mailem
Nasz kanał na YouTube. Prezenter w postaci cybertygrysa opisuje lokalne narzędzia AI i to, do czego faktycznie służą.
KANAŁ · transmisja na żywo
Wyselekcjonowane listy na GitHubie dla agentów do programowania w obszarze sztucznej inteligencji, serwerów MCP, lokalnych rozwiązań opartych na sztucznej inteligencji oraz Linuxa do zastosowań w tej dziedzinie. Każda pozycja zawiera link do źródła.
BEZPŁATNE · starannie wybrane
Szczegółowe instrukcje dotyczące lokalnego AI na Linux, Windows i macOS, wraz z plikami konfiguracyjnymi.
BEZPŁATNE · na żywo
Negatywna kuracja: praktyki i narzędzia, które marnują Twój czas, sklasyfikowane. Dowody wymagane.
BEZPŁATNE · na żywo
Kim jesteśmy, dlaczego tworzymy sztuczną inteligencję skupioną na prywatności i czego nie zrobimy.