Brethof Voice Pro v1.0 on tänään ladattavissa Windows 10/11- ja Linux-järjestelmiin (Ubuntu, Fedora, Arch). Se on työpöytäsovellus, joka tallentaa äänen mikrofonistasi ja suorittaa Qwen-pohjaisen ASR-mallin paikallisesti CPU:llasi tai GPU:llasi, ja kirjoittaa transkriptoidun tekstin ikkunaan, jossa sinulla on kohde.
Mitä toimitetaan versiossa 1.0
- 30 transkriptiokieltä ja 38 käännöskieltä — Arabia, kantoninkiina, kiina, tšekki, tanska, hollanti, englanti, filippiini, suomi, ranska, saksa, kreikka, hindi, kroatia, unkari, indonesia, italia, japani, korea, makedonia, malaiji, persia, puola, portugali, romania, venäjä, serbia, slovakia, sloveeni, espanja, ruotsi, thai, turkki, ukraina, vietnam, bulgaria.
- Globaali pikanäppäinsanelu — paina pikanäppäintä missä tahansa, puhu, vapauta, ja teksti kirjoitetaan aktiiviseen sovellukseen.
- 100 % offline-tila — ei pilveä, ei telemetriaa, ei tiliä transkriptiota varten.
- Kolme mallitasoa — perus (nopea, 0,6 mrd. parametria), keskitaso (1,7 mrd.), suuri (3 mrd.). Valitse laitteistosi mukaan.
- Melunvaimennus DeepFilterNetin kautta ja puheaktiivisuuden tunnistus Silero VAD:n kautta, molemmat toimivat paikallisesti.
- Avainsanat — syötä nimet, lyhenteet ja alan termit päätelmäaikaisiksi vihjeiksi (ei uudelleenkoulutusta tarvita).
Yksi asia ei versiossa v1.0: mallin hienosäätö. Aiemmissa versioissa se toimi PyTorchin kautta, mutta kun siirsimme päätelmän GGUF-muotoon, koulutusputki rikkoutui, emmekä toimita sitä ennen kuin muunnosvaihe on vakaa. Katso hienosäädön aikataulupostaus.
Hinnat
Kertamaksu, ei tilausta:
- Personal — 2 laitetta, kattaa yksinyrittäjien ja freelancereiden kaupallisen käytön. Katso hinnasto.
- Business — Tiimi-/organisaatiokäyttö määräalennuksilla alkaen 10 käyttäjästä. Katso hinnasto.
- 14 päivän ilmainen kokeilu — ei luottokorttia, kaikki ominaisuudet avattu.
Hinnat säätävät automaattisesti alueen mukaan: jos asut Itä-Euroopassa, Kaakkois-Aasiassa, Latinalaisessa Amerikassa tai Afrikassa, näet ostopariteettihinnoittelun.
Missä onnistuimme
Asia, josta olemme eniten tyytyväisiä, on aika ensimmäiseen sanaan. Avaa sovellus, paina pikanäppäintä, puhu. Ei rekisteröitymistä. Ei selainta. Ei latausta. Ei pilven vastauksen odottelua. Keskitason kannettavalla Voice Pro transkriboi viiden sekunnin lauseen alle 400 millisekunnissa perusmallilla. Tämä nopeus oli koko pointti.
Mitä seuraavaksi
- macOS-versio — käynnissä, tavoite Q3 2026.
- Hienosäätö äänesi ja sanastosi perusteella — tulossa, kun PyTorchista GGUF:ään -muunnosputki on valmis. Tavoite: vuoden 2026 kolmas neljännes.
- Reaaliaikainen suoratoistotila — sanat näkyvät puhuessasi, eivät vasta kun vapautat pikakuvakkeen.
- Lisää mallitasoja — erittäin pieni reunalaite-malli heikompaan laitteistoon ja 7B-malli tehokkaampiin koneisiin.
Jos olet odottanut yksityisyyttä kunnioittavaa sanelutyökalua, tänään on se päivä. Lataa kokeiluversio, sanele 14 päivän ajan ja kerro meille, missä se pettää. Luemme jokaisen sähköpostin.