इस ऐप की नवीनतम जानकारी, एक-एक अपडेट के रूप में उपलब्ध होती है। यदि आप सबसे नई संस्करण पर हैं, तो यह वह सूची है जिसमें आपके पास पहले से मौजूद सुविधाएँ दर्शाई गई हैं – एवं चेंजलॉग के नीचे दी गई टिप्पणियाँ इनमें से कुछ बदलावों के पीछे के कारणों को समझाती हैं।
पिछले संस्करण में हुई त्रुटि के कारण, द्वि-कारक प्रमाणीकरण वाले खाते लॉगिन करने में असमर्थ हो गए थे। v2.3.1 इस समस्या को दूर करता है। यदि आपके साथ भी ऐसा ही हुआ है, तो अपने लॉगिन विवरण एवं कोड दर्ज करें, और आप लॉगिन कर सकेंगे। अन्य कोई बदलाव नहीं हुआ है।
अब एक सबटाइटल फ़ाइल का अनुवाद करने में पहले की तुलना में लगभग आधा समय ही लगता है। समय-संबंधी जानकारियों में कोई बदलाव नहीं आता – हर टाइमस्टैम्प ठीक उसी जगह पर होता है जहाँ वह मूल फ़ाइल में था, चाहे आप वाक्य-स्तर पर या शब्द-स्तर पर ही अनुवाद करवाएँ। यदि आप अनुवाद के काम से ही अपनी आजीविका चलाते हैं, तो यही वह संस्करण है जिसमें प्रतीक्षा का समय काफी कम हो गया है।
v2.2.2 में भी:
translate_batch MCP टूल — एक ही कॉल में कई स्ट्रिंग्स का अनुवाद करें; बैच-साइज़ पैरामीटर ऐसा है जो यदि VRAM कम हो जाए तो स्वचालित रूप से कम हो जाता है।एक बार जब आप Brethof Voice Pro को खरीद लेते हैं, तो यह आपका ही हो जाता है, और वर्जन 2.2.1 सुनिश्चित करता है कि आपके एवं इस सॉफ्टवेयर के बीच कुछ भी न आए। पहले लॉन्च के समय होने वाली लाइसेंस जाँच एक बाधा के रूप में कार्य करती थी—बिना इंटरनेट के, व्यस्त सर्वर के, या ऐसे फायरवॉल के कारण जो अनुमति नहीं देते थे, आप उस सॉफ्टवेयर तक नहीं पहुँच पाते थे जिसके लिए आपने पैसे दिए थे। अब ऐसी बाधाएँ नहीं हैं—यदि जाँच हम तक नहीं पहुँच पाती, तब भी ऐप खुल ही जाता है। आपके स्वामित्व वाले सॉफ्टवेयर को शुरू होने हेतु अनुमति माँगनी ही नह
अब लंबे समय तक चलने वाली रिकॉर्डिंगें बैकग्राउंड में ही पूरी हो जाती हैं। आप दो घंटे की बैठक संबंधी फ़ाइल दे दीजिए एवं कॉफी बनाने चले जाइए – इसकी कोई समय-सीमा नहीं है, एवं इसकी निगरानी करने की भी कोई आवश्यकता नहीं है। इसे ऐसे ही चलने दीजिए, यह अपने आप ही पूरा हो जाएगा एवं आपके लिए ट्रांसक्रिप्ट भी तैयार कर देगा। तीन घंटे की कॉल, तीन मिनट की कॉल से कोई अंतर नहीं होता; बस इसमें अधिक समय लगता है।
list_loopback_sources उपलब्ध विकल्पों को देखने हेतु उपकरण।अब उसी मशीन पर मौजूद एक एजेंट, MCP के माध्यम से Brethof Voice Pro का उपयोग कर सकता है — ट्रांसक्राइब करना, अनुवाद करना, रिकॉर्ड करना। यह लोकल HTTP के माध्यम से काम करता है; इसलिए वह एजेंट भी इसका उपयोग API कुंजी के बिना एवं मशीन से कुछ भी बाहर न जाने देते हुए कर सकता है जो केवल URL के माध्यम से ही कुछ प्राप्त कर सकता है। एक टोकन द्वारा इसकी सुरक्षा की जाती है, एवं बिना इसके सर्वर काम शुरू नहीं करता। इसके लिए एक शुल्कित लाइसेंस आवश्यक है।
यही सबसे शक्तिशाली विकल्प है। अब अनुवाद पूरी तरह से आपके ही कंप्यूटर पर 38 भाषाओं में होता है। एक बार बोलें, और यह संदेश एक ही समय में अंग्रेजी, जापानी, फ्रांसीसी एवं स्पेनिश में टाइप हो जाएगा – प्रत्येक भाषा अलग पंक्ति में, या एक ही पंक्ति में एक-दूसरे के बगल में। इसका इंजन टेंसेंट का Hunyuan MT2 है, जिसके दो संस्करण उपलब्ध हैं: रोजमर्रा के उपयोग हेतु तेज़ संस्करण, एवं महत्वपूर्ण कार्यों हेतु उच्च गुणवत्ता वाला संस्करण। उच्च गुणवत्ता वाले संस्करण में, FLORES-200 बेंचमार्क पर यह Google Gemini 3.1 Pro की तुलना में 97.9% तक बेहतर प्रदर्श
v2.0.0 में क्या नया है:
EN: … || PL: …), या केवल पहला लक्ष्य।translate_text, translate_srt, list_compute_devices, set_compute_device. कुल टूल काउंट अब 19 है।Linux बाइनरी 161 MB है, Windows इंस्टॉलर 118 MB है। मौजूदा लाइसेंस वैसे ही लागू रहते हैं — बस v2.0.0 डाउनलोड करें और अनुवाद मॉडल Settings → Models में दिखाई देंगे।
v2.0.0 डाउनलोड करें →Brethof Voice Pro अब आपकी आवाज़ पर ही प्रशिक्षण लेता है। प्रशिक्षण डेटा वे सुधार हैं जो आप पहले ही कर चुके हैं – किसी गलत सुनी गई शब्द को ठीक करने पर वही उदाहरण बन जाता है। आपसे कभी भी नमूना वाक्य पढ़ने को नहीं कहा जाता। प्रशिक्षण केवल एक क्लिक में ही हो जाता है, यह आपके ही हार्डवेयर पर चलता है, एवं जब यह पूरा हो जाता है तो नया मॉडल उपयोग हेतु तैयार हो जाता है।
यह परीक्षण पर्सनल ट्रेनिंग एवं एजेंट कनेक्शन को छोड़कर सब कुछ उपलब्ध कराता है; यह उन लोगों के लिए है जो हर दिन ऐप का उपयोग करते हैं।
दो बातें। अब ट्रांसक्रिप्शन को एक असिंक्रोनस जॉब के रूप में चलाया जा सकता है – ऑडियो फ़ाइल डाल दें, जब काम पूरा हो जाए तब ही ट्रांसक्रिप्शन प्राप्त करें; इसके सामने बैठने की आवश्यकता नहीं है।
और उपशीर्षकों का समय निर्धारण: अब आप पूरे वाक्यों के बजाय शब्द-दर-शब्द ही समय निर्धारित कर सकते हैं, खासकर तब जब आपको सटीक रूप से संपादन करने की आवश्यकता हो। यदि आप उपशीर्षक बनाते हैं, तो आपको पहले से ही पता होगा कि यह क्यों महत्वपूर्ण है।
ONNX रनटाइम अब मौजूद नहीं है। अब पूरा उत्पाद llama.cpp एवं हमारे स्वयं के अनुवाद लाइब्रेरी पर ही चलता है — एक ही रनटाइम, डिस्क पर कम जगह घेरता है, शुरू होने में तेज़ है, एवं इसे भेजना भी आसान है।
ये मॉडल एकल GGUF बंडल हैं; इसी कारण छोटा मॉडल किसी भी 4 जीबी वाले ग्राफिक्स कार्ड पर काम कर सकता है। इस बारे में अधिक जानकारी पृष्ठ के नीचे दी गई है।
दो पहलें। यहाँ MCP सर्वर पहली बार प्रस्तुत किया गया है — अपनी ही मशीन पर किसी एजेंट को “कान” देने का पहला तरीका।
और डिवाइस चुनने की सुविधा: अब ट्रांसक्रिप्शन एवं अनुवाद दोनों ही अपने-अपने प्रोसेसर का चयन कर सकते हैं; इस प्रकार एक कार्य आपके ग्राफिक्स कार्ड पर चल सकता है, जबकि दूसरा कार्य CPU पर चल सकता है। एक साधारण GPU वाला लैपटॉप भी दोनों कार्यों को बिना किसी रुकावट के चला सकता है।
macOS विकासाधीन है, पहले Apple Silicon संस्करण आएगा। इसकी कोई तारीख निर्धारित नहीं है, और जब तक यह वास्तव में तैयार नहीं हो जाता, हम आपको कोई तारीख नहीं बताएँगे। इस बीच, Linux एवं Windows में समान सुविधाएँ हैं — एक को बेचने हेतु दूसरे में कोई कमी नहीं रखी गई है। जब Mac संस्करण उपलब्ध होगा, तो यह पृष्ठ इसकी जानकारी देगा।
पोस्ट पढ़ें →आपका लहजा कोई ऐसी समस्या नहीं है जिसे दूर किया जाए; बल्कि यह तो एक ऐसा मॉडल है जिसे प्रशिक्षित किया जा सकता है। Brethof Voice Pro, आपके द्वारा पहले से किए गए सुधारों से ही सीखता है — अगर आपने किसी गलत सुने गए शब्द को एक बार सही किया, तो वही सुधार एक उदाहरण बन जाता है। न तो कोई नमूना वाक्य, न ही कोई कैलिब्रेशन स्क्रिप्ट, न ही माइक में घंटों बोलने की आवश्यकता। आपके द्वारा पहले से ही निर्धारित शब्द — ब्रांड नाम, विशेषज्ञता संबंधी शब्द, सहकर्मियों के नाम — ही ट्रांसक्रिप्ट एवं अनुवाद दोनों को निर्देशित करते हैं; इसलिए कोई नाम गलती से स्थ
पोस्ट पढ़ें →पहला संस्करण। टाइप करने के बजाय बोलें – चाहे वह आपका एडिटर हो, टर्मिनल हो, चैट बॉक्स हो, या फॉर्म हो – और शब्द कर्सर के स्थान पर ही पहुँच जाएँगे। रिकॉर्डिंग पूरी तरह से आपके ही कंप्यूटर पर होती है; इसमें अलीबाबा का Qwen3-ASR, नॉइज़ को दूर करने हेतु DeepFilterNet3, एवं आवाज़ पहचानने हेतु Silero VAD का उपयोग किया जाता है। यह सब कुछ स्थानीय ही होता है। आपकी वकील से बातचीत, अभी तक जारी न हुआ उत्पाद, मरीज़ों संबंधी नोट्स – ये सब कुछ उसी कंप्यूटर से बाहर नहीं जाते, क्योंकि इनके जाने का कोई रास्ता ही नहीं है। यह विमान में, टनल से गुज
पोस्ट पढ़ें →अब यह व्यक्तिगत लाइसेंस सोलो बिजनेस एवं फ्रीलांस कार्यों को भी कवर करता है। यदि आप एकमात्र व्यापारी, एक-व्यक्ति वाला स्टूडियो, या ठेकेदार हैं, तो आपके द्वारा खरीदी गई लाइसेंस आपके कार्यों को कवर करेगी। प्रति उपयोगकर्ता लेखांकन नहीं, कोई अलग बिजनेस स्तर नहीं। एक ही लाइसेंस, दो उपकरण, एक बार में ही खरीदना होगा। इसमें एक वर्ष के लिए अपडेट शामिल हैं; उस वर्ष के बाद अपडेट वैकल्पिक हो जाते हैं, एवं ऐप आपके पास मौजूद संस्करण पर ही अनिश्चित काल तक काम करता रहेगा। जिस सॉफ्टवेयर के लिए आपने भुगतान किया है, वह आपका ह
पोस्ट पढ़ें →Brethof Voice Pro 30 भाषाओं में पाठ लिख सकता है, 22 चीनी क्षेत्रीय बोलियों को पहचान सकता है, एवं 38 भाषाओं में अनुवाद कर सकता है। इसका इंटरफ़ेस उन 30 भाषाओं में पूरी तरह से अनुवादित है — ऐसे लोगों द्वारा जो इस उत्पाद का उपयोग करते हैं, मशीनी अनुवाद के जरिए नहीं। आप ऐप को अपनी भाषा में सेट कर सकते हैं, एवं यह ऐसे ही पढ़ा जाएगा जैसे वह वहीं लिखा गया हो, क्योंकि वास्तव में ऐसा ही है।
पोस्ट पढ़ें →पहले वर्जनों का निर्माण ONNX Runtime पर किया गया। यह काम करता था, लेकिन यह भारी था, इसे भेजना मुश्किल था, एवं इसकी वजह से उत्पाद आवश्यकता से अधिक बड़ा हो जाता था। v1.5.0 में इसकी जगह एक ही रनटाइम – ट्रांसक्रिप्शन हेतु llama.cpp एवं अनुवाद हेतु हमारा स्वयं का लाइब्रेरी – लाया गया, एवं मॉडल एकल GGUF बंडलों के रूप में आने लगे। इसके परिणामस्वरूप डाउनलोड आकार कम हो गया, शुरू होने में तेज़ी आई, एवं उत्पाद लैपटॉप पर आसानी से फिट होने लगा। दो मॉडल आकार उपलब्ध हैं; यह एक विकल्प है, न कि विभिन्न स्तर – छोटा मॉडल लैपटॉप एवं इंटी
पोस्ट पढ़ें →तीन चीजें ही नेटवर्क तक पहुँचती हैं, और कुछ भी नहीं। ऐप शुरू होने पर लाइसेंस जाँच होती है; ऐप शुरू होने पर अपडेट जाँच भी होती है। आप स्वयं ही मॉडलों को डाउनलोड करते हैं। लाइसेंस जाँच से लाइसेंस कुंजी भेजी जाती है; अपडेट जाँच से वर्जन स्ट्रिंग भेजी जाती है। ये दोनों में से कोई भी ऑडियो या टेक्स्ट नहीं भेजता। एक बार जब मॉडल डिस्क पर हो जाते हैं एवं अपडेट जाँच बंद हो जाती है, तो कुछ भी बाहर नहीं जाता। यह कोई मार्केटिंग वाक्य नहीं है – फायरवॉल लॉग ही इसे दर्शाएगा। सब कुछ अपने ही कंप्यूटर पर चलाने का क
पोस्ट पढ़ें →प्रत्येक रिलीज के साथ एक ही ईमेल, जिसमें ऊपर चेंजलॉग दिया गया हो। कोई स्पैम नहीं, कोई सुझाव नहीं, कोई साप्ताहिक न्यूज़लेटर नहीं। जब चाहें, एक क्लिक में ही सब्सक्रिप्शन रद्द कर सकते हैं।
खाता बनाएँआपकी आवाज़ सीखने वाला लोकल स्पीच-टू-टेक्स्ट। परपेचुअल लाइसेंस। हमारा फ्लैगशिप।
भुगतान किया गया · फ्लैगशिप
आपके AI एजेंटों के लिए दीर्घकालिक स्मृति — पूर्ण-पाठ + वेक्टर + ग्राफ। सत्र शुरू होने पर जानकारी दी जाती है, प्रत्येक प्रॉम्प्ट पर याद किया जाता है, एवं स्वचालित रूप से आर्काइव किया जाता है।
भुगतान किया गया · मुफ्त स्तर
प्रिंट-तैयार डिजिटल मॉडल। GLB एवं OBJ शामिल हैं। आजीवन पहुँच।
भुगतान किया गया · डिजिटल कैटलॉग
पाँच प्रिंटर, वास्तविक क्षमता। अभी तक कोई स्व-सेवा दुकान नहीं है — हमें बताइए कि आपको क्या चाहिए, हम ईमेल के माध्यम से आपको कीमत बता देंगे।
व्यवस्था के तहत · हमें ईमेल करें
हमारा YouTube चैनल। एक साइबर-टाइगर होस्ट स्थानीय AI उपकरणों एवं उनके वास्तविक कार्यों के बारे में जानकारी देता है।
चैनल · लाइव
AI कोडिंग एजेंट्स, MCP सर्वर्स, स्थानीय AI एवं AI के लिए Linux संबंधी चयनित GitHub सूचियाँ। प्रत्येक प्रविष्टि में एक स्रोत लिंक होता है।
मुफ़्त · चयनित
Linux, Windows एवं macOS पर स्थानीय AI के लिए विस्तृत मार्गदर्शिकाएँ, जिसमें कॉन्फ़िगरेशन फ़ाइलें भी शामिल हैं।
मुफ्त · लाइव
नकारात्मक-क्यूरेशन: आपका समय बर्बाद करने वाली प्रथाएँ और उपकरण, रैंक किए गए। रसीद आवश्यक है।
मुफ्त · लाइव
हम कौन हैं, हम गोपनीयता-प्रथम एआई क्यों विकसित करते हैं, और हम क्या नहीं करेंगे।