NOWOŚĆ · v2.0.0

Wszystko w jedna aplikacja

Już teraz mówisz szybciej, niż piszesz. Brethof Voice Pro to jedyna aplikacja, która słucha. Jest to klawiatura głosowa, która umieszcza słowa tam, gdzie znajduje się Cursor.

Transkrypt To narzędzie do transkrypcji, które uczestniczy w dwugodzinnym spotkaniu i później przekazuje ci transkrypt.

Powiedz raz. To tłumacz, który bierze jedno wypowiedziane zdanie i zapisuje je jednocześnie w czterech językach.

Napisy To narzędzie do napisów dla własnego filmu, które słucha zarówno głośników, jak i mikrofonu – spotkania, w którym uczestniczyłeś jako gość, filmu bez napisów.

Wgraj dwugodzinne nagranie i idź zrobić kawę.Wszystko to na jednym komputerzenie w czyimś chmurze

Brethof Voice Pro — Main Screen
Brethof Voice Pro — Recording

Twój głos nigdy nie opuszcza twojego komputera

To zdanie stanowi całą prezentację produktu i jest wystarczające. Do sieci trafiają trzy elementy, i to tylko wtedy: sprawdzenie licencji przy uruchomieniu, sprawdzenie aktualizacji przy uruchomieniu oraz pobranie modelu przez użytkownika. Żadnego dźwięku, żadnego tekstu – nigdy.

  • Brak dźwięku. Brak tekstu. Nigdy.
  • Gdy modele znajdą się na twoim dysku, a sprawdzanie aktualizacji jest wyłączone, nic nie jest wysyłane.
  • Brak sieci, żaden problem.

Działa na laptopie, który już posiadasz

Nie wymaga stanowiska roboczego. Mała wersja działa na dowolnej karcie graficznej o pojemności 4 GB, a całość może funkcjonować nawet bez karty graficznej – wystarczy 8 GB pamięci RAM, procesor x86_64 z czterema rdzeniami oraz 5 GB miejsca na dysku.

  • NVIDIA — Karty graficzne Vulkan 1.2+
  • AMD — Karty graficzne Vulkan 1.2+
  • W Linuxie dostępny jest jako jeden plik przenośny, bez konieczności instalacji niczego.
  • W systemie Windows jest to zwykły instalator, który nie wymaga uprawnień administratora.

Trzydzieści języków, dwadzieścia dwa dialekty chińskie, na twoim urządzeniu

Potrafi transkrybować teksty w trzydziestu językach oraz samodzielnie rozpoznawać dwadzieścia dwa chińskie dialekty regionalne, bez konieczności podania informacji o tym, który z nich jest używany.

AngielskiChińskiKantońskiArabski NiemieckiFrancuskiHiszpańskiPortugalski WłoskiHolenderskiRosyjskiIndonezyjski KoreańskiTajskiWietnamskiJapoński TureckiHindiMalajskiSzwedzki DuńskiFińskiPolskiCzeski FilipińskiPerskiGreckiRumuński WęgierskiMacedoński

Wszystko to działa na twoim komputerze, bez opłat za minutę i bez konieczności przesyłania danych.

Tłumaczenie na 38 języków — nowość w wersji 2.0.0

Tłumaczenie na trzydzieści osiem języków — nowość w wersji 2.0.0

ChińskiAngielskiFrancuskiPortugalski HiszpańskiJapońskiTureckiRosyjski ArabskiKoreańskiTajskiWłoski NiemieckiWietnamskiMalajskiIndonezyjski FilipińskiHindiChiński uproszczonyPolski CzeskiHolenderskiKhmerBirmijski PerskiGudżaratiUrduTelugu MarathiHebrajskiBengalskiTamilski UkraińskiKantońskiTybetańskiKazachski MongolskiUjgurski
  • Mów po polsku – dostaniesz angielski. Mów po angielsku – dostaniesz japoński.
  • Powiedz to raz, a tekst zostanie wpisany jednocześnie po angielsku, japońsku, francusku i hiszpańsku — po jednym w każdej linii lub obok siebie w tej samej linii, tylu języków docelowych, ile chcesz.
  • Tłumaczenie radzi sobie dobrze w konkurencji z gigantami chmurowymi. Wykorzystując silnik Hunyuan MT2 firmy Tencent, osiąga na teście FLORES-200 jakość na poziomie 97,9% w porównaniu z Google Gemini 3.1 Pro, a także przewyższa go w tłumaczeniach z praktycznego zastosowania oraz w językach mniejszościowych.
  • Napisy również – tekst prosty lub w formacie SRT, zsynchronizowane z zdaniami, albo słowo po słowie, gdy potrzebna jest precyzyjna edycja.
  • Tłumaczenie pliku napisów zachowuje całkowicie oryginalną synchronizację.

Twój sprzęt, twoja decyzja

Dwa rozmiary modeli – wybór, a nie poziom: mniejszy do laptopów i grafiki zintegrowanej, większy do dźwięku o wyraźniejszym brzmieniu lub głośniejszym dźwięku. Można je zmieniać w dowolnym momencie. Transkrypcja i tłumaczenie korzystają z oddzielnych procesorów, więc jedno może działać na karcie graficznej, podczas gdy drugie na procesorze CPU.

  • Mały — dla laptopów i grafiki zintegrowanej
  • Duży — dla nagrania z akcentem lub hałasem

Dodatkowe moduły pobierane na żądanie z Ustawienia → Modele: Forced Aligner (~540 MB) dla znaczników czasu na poziomie słów, Hunyuan MT2 Fast (~1 GB) lub Jakość (~4,3 GB) na potrzeby tłumaczenia.

Redukcja szumów

Redukcja hałasu służy do nagrań dokonywanych w hałaśliwym pomieszczeniu.

  • Domyślnie jest wyłączone, ponieważ zostało tak ustawione, aby pogorszyć jakość krótkich, czystych nagrań mikrofonowych.
  • Włącz to, gdy w pomieszczeniu jest głośno.
  • Pomij to, jeśli twoje nagranie jest w porządku.
  • Wyłączone domyślnie — przełączanie dla każdego nagrania lub tryb zawsze włączony

Uczy się na podstawie korekt, które już wprowadzasz.

Większość aplikacji do rozpoznawania mowy prosi o przeczytanie przykładowych zdań. Ta natomiast uczy się na błędach, które już popełniasz: poprawiasz źle usłyszane słowo, a ta poprawka staje się przykładem.

  • Żadnych nagrań przykładowych, żadnego zadania domowego.
  • Szkolenie – jeden kliknięcie
  • Działa na twoim własnym sprzęcie
  • Nowy model będzie gotowy do użycia po zakończeniu pracy obecnego.
  • Brak sesji nagraniowych
  • Brak „proszę powtórzyć następujący akapit”.
  • Tylko twój głos i poprawki, które i tak zamierzałeś wprowadzić

Klawiatura, która słucha

Pisz w dowolnym miejscu, gdzie znajduje się Cursor – w edytorze, terminalu, oknie czatu, formularzu, w każdym polu przyjmującym dane z klawiatury. A jeśli chcesz, może wpisywać tłumaczenie zamiast transkrypcji: powiedz to po polsku, a tekst w języku angielskim pojawi się na stronie.

  • Mikrofon
  • Plik dźwiękowy lub wideo
  • Dźwięk odtwarzany przez twoje głośniki
  • Działa z każdym polem tekstowym, edytorem, terminalem lub czatem
  • X11 i Wayland w systemie Linux, natywne wprowadzanie w systemie Windows

Twoje słowa, napisane twoim sposobem

Nazwy marek, żargon, imiona kolegów. Ustaw je raz i nie będą już błędnie wyświetlane. Ta sama lista kieruje transkrypcją i tłumaczeniem, więc nazwa nigdy nie zostanie przypadkowo zlokalizowana. Popraw słowo źle usłyszane raz – staje się ono danymi treningowymi; nigdy nie będzie cię proszono o jego odczytanie w celach ćwiczeń.

  • Dodaj terminy w Ustawieniach — po jednym w linii
  • Poprawia rozpoznawanie nazw własnych i skrótów
  • Zachowuje nazwy marek i terminy techniczne w tłumaczeniach
  • Nie jest potrzebne ponowne trenowanie — stosowane w czasie wnioskowania

Agent dostaje uszy

Daj swojemu agentowi AI możliwość słuchania. Dzięki MCP może on transkrybować, tłumaczyć i nagrywać spotkania dowolnej długości na twoim komputerze, bez klucza API.

  • Transkrybuj pliki audio/wideo, nagrania z mikrofonu lub dźwięk systemowy
  • Tłumacz tekst, SRT lub VTT (obsługiwany tryb dwujęzyczny)
  • Przełączaj urządzenie obliczeniowe ASR lub MT w locie
  • Wyświetlaj i przełączaj osobiste profile głosowe
  • Odczyt/zapis dowolnego ustawienia aplikacji z poziomu agenta

Rozmowa trwająca trzy godziny nie różni się od tej trwającej trzy minuty – nie trzeba niczego pilnować, a jeśli zapomnisz, że nagrywa się, nic się nie straci: sama się zakończy i zachowa dla ciebie transkrypt.

Gotowy, by to wypróbować?

Gotowy, by to wypróbować? Próba trwa czternaście dni i wymaga jedynie adresu e-mail – bez konieczności podawania karty. Dostępna jest do wszystkiego z wyjątkiem indywidualnych treningów oraz połączenia z agentem. Po zakupie otrzymuje się licencję wieczystą wraz z rokiem aktualizacji. Po tym okresie aktualizacje są opcjonalne, a bez nich aplikacja będzie nadal działać na posiadanym przez Ciebie wersji bezterminowo. Będzie działać przez pięć lat, niezależnie od tego, czy ponownie nam zapłacisz. Licencja osobista obejmuje dwa urządzenia; w przypadku zespołów licencje nabywa się za każdego użytkownika, z zniżkami grupowymi, priorytetowym wsparciem oraz panelami kontrolnymi. Kup raz – pozostanie Twoja.

Usłyszysz, gdy się ukaże

Nowe wydania, prawdziwe benchmarki i okazjonalne dogłębne analizy. Bez spamu, rezygnacja jednym kliknięciem.

Wszystko, co tworzymy

Voice Pro

Lokalna konwersja mowy na tekst, która uczy się Twojego głosu. Licencja dożywotnia. Nasz flagowy produkt.

Płatny · flagowy

brethof-brain

Pamięć długoterminowa dla twoich agentów AI — tekst pełny + wektory + grafy. Informacje są przekazywane na początku sesji, przywoływane przy każdym zapytaniu i automatycznie archiwizowane.

Opłacone · plan bezpłatny

Modele 3D

Gotowe do druku modele cyfrowe. Zawiera GLB i OBJ. Dostęp dożywotni.

Płatny · katalog cyfrowy

Druk 3D

Pięć drukarek o rzeczywistej mocy. Jeszcze nie ma sklepu samoobsługowego — podaj nam, czego potrzebujesz, a prześlemy wycenę e-mailem.

Za umową · napisz do nas e-mailem

Nova

Nasz kanał na YouTube. Prezenter w postaci cybertygrysa opisuje lokalne narzędzia AI i to, do czego faktycznie służą.

KANAŁ · transmisja na żywo

Świetne listy

Wyselekcjonowane listy na GitHubie dla agentów do programowania w obszarze sztucznej inteligencji, serwerów MCP, lokalnych rozwiązań opartych na sztucznej inteligencji oraz Linuxa do zastosowań w tej dziedzinie. Każda pozycja zawiera link do źródła.

BEZPŁATNE · starannie wybrane

Przewodniki

Szczegółowe instrukcje dotyczące lokalnego AI na Linux, Windows i macOS, wraz z plikami konfiguracyjnymi.

BEZPŁATNE · na żywo

Lista rankingowa anty-dev

Negatywna kuracja: praktyki i narzędzia, które marnują Twój czas, sklasyfikowane. Dowody wymagane.

BEZPŁATNE · na żywo

O Brethof AI

Kim jesteśmy, dlaczego tworzymy sztuczną inteligencję skupioną na prywatności i czego nie zrobimy.

Zewnętrzne: YouTube · GitHub