आज Brethof Voice Pro v1.0 Windows 10/11 और Linux (Ubuntu, Fedora, Arch) पर डाउनलोड के लिए उपलब्ध है। यह एक डेस्कटॉप एप्लिकेशन है जो आपके माइक्रोफोन से ऑडियो कैप्चर करता है, Qwen-आधारित ASR मॉडल चलाता है स्थानीय रूप से अपने CPU या GPU पर, और ट्रांसक्राइब किया गया टेक्स्ट उस विंडो में टाइप करें जिस पर आपका ध्यान है।
v1.0 में क्या शामिल है
- 30 ट्रांसक्रिप्शन भाषाएँ + 38 अनुवाद भाषाएँ — अरबी, कैंटोनीज़, चीनी, चेक, डेनिश, डच, अंग्रेज़ी, फिलिपिनो, फिनिश, फ्रेंच, जर्मन, ग्रीक, हिंदी, क्रोएशियन, हंगेरियन, इंडोनेशियन, इतालवी, जापानी, कोरियन, मैसिडोनियन, मलय, फ़ारसी, पोलिश, पुर्तगाली, रोमानियन, रूसी, सर्बियन, स्लोवाक, स्लोवेनियन, स्पेनिश, स्वीडिश, थाई, तुर्की, यूक्रेनियन, वियतनामी, बल्गेरियन।
- वैश्विक हॉटकी डिक्टेशन — कहीं भी अपना हॉटकी दबाएं, बोलें, छोड़ दें, और पाठ उस ऐप में टाइप हो जाएगा जिस पर ध्यान केंद्रित है।
- 100% ऑफलाइन — कोई क्लाउड नहीं, कोई टेलीमेट्री नहीं, ट्रांसक्राइब करने के लिए कोई खाता आवश्यक नहीं।
- तीन मॉडल टियर — base (तेज़, 0.6B params), medium (1.7B), large (3B)। अपने हार्डवेयर के आधार पर चुनें।
- शोर कम करना DeepFilterNet के माध्यम से और वॉइस एक्टिविटी डिटेक्शन Silero VAD के माध्यम से, दोनों स्थानीय रूप से चल रहे हैं।
- हॉटवर्ड्स — names, acronyms, और domain terms को inference-time hints के रूप में inject करें (retraining की आवश्यकता नहीं)।
एक बात नहीं v1.0 में: मॉडल fine-tuning। Earlier builds में यह PyTorch के माध्यम से था, लेकिन जब हमने inference को GGUF पर स्विच किया, तो training pipeline टूट गई और हम conversion step solid होने तक इसे ship नहीं कर रहे हैं। देखें फाइन-ट्यूनिंग रोडमैप पोस्ट.
मूल्य निर्धारण
एक बार का भुगतान, कोई सब्सक्रिप्शन नहीं:
- Personal — 2 मशीनें, एकल और फ्रीलांस व्यावसायिक उपयोग को कवर करता है। कीमत देखें।.
- Business — 10 सीटों से शुरू होने वाले बड़े ऑर्डरों पर टीम/संगठनों के लिए मात्रा छूट। कीमत देखें।.
- 14 दिनों का मुफ़्त परीक्षण — कोई क्रेडिट कार्ड आवश्यक नहीं, सभी सुविधाएँ अनलॉक हैं।
कीमतें क्षेत्र के अनुसार स्वचालित रूप से समायोजित हो जाती हैं: यदि आप पूर्वी यूरोप, दक्षिण-पूर्व एशिया, लैटिन अमेरिका या अफ्रीका में हैं, तो आपको खरीद शक्ति-समानता (PPP) आधारित कीमतें दिखाई जाएंगी।
हमने क्या सही किया
जिस बात पर हमें सबसे अधिक खुशी है, वह है पहले शब्द तक का समय. ऐप खोलें, अपनी हॉटकी दबाएँ, और बोलें। कोई साइनअप नहीं। कोई ब्राउज़र नहीं। कोई अपलोडिंग नहीं। क्लाउड राउंड-ट्रिप की कोई प्रतीक्षा नहीं। एक मिड-रेंज लैपटॉप पर, Voice Pro बेस मॉडल के साथ पाँच सेकंड के वाक्य को 400 मिलीसेकंड से भी कम समय में ट्रांसक्राइब कर देता है। यही गति इसका पूरा उद्देश्य थी।
आगे क्या है
- macOS बिल्ड — प्रगति में है, लक्ष्य Q3 2026 है।
- आपकी आवाज़ और शब्दावली पर फाइन-ट्यूनिंग — PyTorch-to-GGUF कन्वर्जन पाइपलाइन तैयार होते ही आएगा। Q3 2026 लक्ष्य।
- रियल-टाइम स्ट्रीमिंग मोड — words आप बोलते समय ही appear होते हैं, hotkey छोड़ने के बाद नहीं।
- अधिक मॉडल टियर्स — लो-एंड हार्डवेयर के लिए एक अत्यंत छोटा एज-डिवाइस मॉडल, और शक्तिशाली मशीनों के लिए 7B मॉडल।
यदि आप ऐसे डिक्टेशन टूल की प्रतीक्षा कर रहे हैं जो गोपनीयता का सम्मान करे, तो आज ही वह दिन है। ट्रायल डाउनलोड करें, 14 दिनों तक डिक्टेशन करें, और हमें बताएँ कि इसमें कहाँ समस्याएँ हैं। हम हर ईमेल को पढ़ते हैं।