شما در حال صحبت کردن هستید. کلمات روی صفحه نمایش میآیند — در ویرایشگر شما، ترمینال، کادر چت، فرم، هر جایی که کرسور قرار دارد. و هر کدام از آنها در همان دستگاهی باقی میمانند که در آن گفته شدهاند.
Brethof Voice Pro یک ابزار تبدیل صدا به متن و ترجمه است که کاملاً روی کامپیوتر شما اجرا میشود. این یک ویژگی مربوط به حریم خصوصی نیست؛ بلکه خود محصول است.
یک برنامه، کار چهار نفر. این برنامه صدای شما را ترجمه میکند، آن را به ۳۸ زبان ترجمه مینماید، زیرنویس ویدیوهای شما را ایجاد میکند و در هر جایی که کیبورد لازم باشد، برای شما تایپ میکند. این برنامه به صورت آفلاین کار میکند — در هواپیما، در هتلهایی با وایفای ضعیف، در تونلها — و روی لپتاپی که از قبل دارید، چه با کارت گرافیک و چه بدون آن. هیچ اشتراکی لازم نیست؛ هیچ هزینهای بر حسب دقیقه وجود ندارد؛ هیچ فایلی نیاز به آپلود ندارد. به این هوش مصنوعی خود گوش نیز بدهید: این برنامه میتواند از طریق MCP، روی دستگاه شما، بدون نیاز به کلید API، متنها را ترجمه کند، ویدیوها را زیرنویسگذاری کند و جلساتی با هر مدت زمانی را ضبط نماید. آن را یک بار خریداری کنید و همیشه کار خواهد کرد.
صدای شما هرگز از کامپیوترتان خارج نمیشود. این جمله دقیق است؛ در زمان ارسال، تنها سه چیز به شبکه میرسد: بررسی مجوز، بررسی بهروزرسانی، و فایلهای مدل که خودتان آنها را دانلود میکنید. بررسی مجوز، کلید مجوز را ارسال میکند؛ بررسی بهروزرسانی، رشتهای حاوی اطلاعات نسخه را ارسال میکند؛ هیچ صدا و هیچ متنی وجود ندارد. اگر بررسی بهروزرسانی را غیرفعال کنید، پس از آنکه مدلها روی دیسک ذخیره شدند، دیگر هیچ چیزی ارسال نخواهد شد.
ترجمه متن به بیش از ۳۰ زبان، و درک ۲۲ گویش منطقهای چینی به صورت خودکار — بدون نیاز به تنظیمات یا آموزش. همچنین لهجه شما دیگر به درستی تلفظ نخواهد شد. Brethof Voice Pro صدای شما، اصطلاحات تخصصی شما و اسامی خاص شما را در دستگاه خودتان یاد میگیرد. حتی اگر به زبان سیچوانی مادربزرگتان صحبت کنید، ترجمه به درستی انجام خواهد شد.
به زبان لهستانی صحبت کنید، به انگلیسی بخوانید؛ به انگلیسی صحبت کنید، به ژاپنی بخوانید. یا آن را یک بار بگویید تا همزمان به زبانهای انگلیسی، ژاپنی، فرانسوی و اسپانیایی تایپ شود — هر کدام در یک خط، یا کنار هم در یک خط. هر تعداد زبان مقصدی که میخواهید انتخاب کنید؛ ۳۸ زبان وجود دارد و ۲۳ زبان در هر دو جهت کار میکنند. ترجمه نیز روی دستگاه شما، در Hunyuan MT2 شرکت تنسنت، انجام میشود. در سطح کیفیت مورد نظر، این سیستم ۹۷.۹٪ از کیفیت Gemini 3.1 Pro گوگل را در استاندارد FLORES-200 دارد و در ترجمههای مربوط به زبانهای کمتعداد و موقعیتهای واقعی، از آن بهتر عمل میکند. دو نسخه وجود دارد که هر دو قابل دانلود اختیاری هستند: یک نسخه سریع برای استفاده روزمره، و یک نسخه با کیفیت بالا برای کلمات مهم. زیرنویس
به همین دلیل است که در جاهایی که روشهای دیگر کارساز نیستند، این روش مؤثر است. یک هواپیما، یک هتل با وایفای ضعیف، یک قطار در حال عبور از تونل… جایی برای ذخیره فایل ضبط شده وجود ندارد؛ بنابراین نیازی به ارسال آن به جایی نیست. فایل ضبط شده یک جلسه دو ساعته را آنجا رها کنید و بروید قهوه درست کنید؛ وقتی برگشتید، متن ضبط شده آنجا خواهد بود. فراموش کنید که آن را در حال ضبط گذاشتهاید؛ هیچ چیز از بین نمیرود—این روش به تنهایی کار خود را انجام میدهد و متن ضبط شده را نگه میدارد.
دو مدل ترجمه وجود دارد؛ این یک انتخاب است، نه یک سطح — میتوانید در هر زمان تغییر دهید.
اکثر نرمافزارهای صوتی، در مرحله راهاندازی از شما میخواهند که جملات نمونه را بخوانید؛ اما این نرمافزار چنین کاری نمیکند. آن از اصلاحاتی که شما انجام میدهید یاد میگیرد: وقتی یک کلمه را به درستی تصحیح میکنید، همان تصحیح به عنوان نمونه آموزشی استفاده میشود. نامهای برندها، اصطلاحات تخصصی و نامهای همکارانتان را یک بار وارد کنید؛ سپس دیگر در متن اصلی و ترجمه، به اشتباه نمایش داده نخواهند شد، زیرا همان لیست بر هر دو حالت تأثیر میگذارد. نامها هرگز به طور تصادفی ترجمه نمیشوند. فرآیند آموزش تنها با یک کلیک انجام میشود، روی سختافزار شما اجرا میگردد و پس از اتمام، مدل جدید آماده استفاده خواهد بود.
یک بار آن را خریداری کنید و آن متعلق به شما خواهد بود. یک مجوز دائمی همراه با یک سال بهروزرسانی در اختیار شما قرار میگیرد.
اتاق پرسروصدا دیگر مشکلی ایجاد نمیکند. کاهش صدا به طور درونی در این دستگاه وجود دارد؛ برای ضبط صدا در کافه، نمایشگاهها یا خودرو. این قابلیت به طور پیشفرض غیرفعال است، زیرا ما آن را امتحان کردهایم: در فایلهای کوتاه و با کیفیت میکروفون، این ویژگی وضعیت را بدتر میکند. برای جلسات دو ساعته که در کنار دستگاه اسپرسو برگزار میشود، آن را فعال کنید.
کیبورد صوتی در هر جایی که کرسر شما قرار دارد متن تایپ میکند — چه در یک مرورگر، چه در یک محیط توسعه، چه در یک برنامه چت، یا هر فیلدی که از کیبورد استفاده کند. همچنین میتواند ترجمه را به جای رونویسی تایپ کند. جمله را به زبان خودتان بگویید و کلمات مناسب در فرم، به زبانی که فرم نیاز دارد، قرار خواهند گرفت. یک خط، بدون برش و چسباندن.
مدل ۰.۶B، مدل روزمره است. این مدل روی هر کارت گرافیک ۴ گیگابایتی، روی گرافیکهای یکپارچه، و حتی روی لپتاپهایی که فاقد کارت گرافیک هستند، قابل استفاده است. سریع، سبک، و در زمان نیاز در دسترس است.
مدل ۱.۷ میلیاردی، مدل مناسبی برای صداهای دارای تأکید صوتی یا پرسروصدا، و همچنین جلسات دو ساعتهای است که در آنها معنای کلمات اهمیت دارد. این مدل به حدود ۶ گیگابایت VRAM نیاز دارد؛ اگر مدل ترجمه با کیفیت بالاتر نیز همزمان فعال شود، این مقدار به ۸ گیگابایت افزایش مییابد.
هیچ GPUای وجود ندارد؟ باز هم کار میکند. سیستمهای تنها مبتنی بر CPU به ۸ گیگابایت RAM، یک پردازنده چهارهستهای و حدود ۵ گیگابایت فضای خالی در دیسک نیاز دارند؛ سایر موارد به ۷ تا ۹ گیگابایت نیاز دارند. هر کارتی که از Vulkan 1.2 به بالا پشتیبانی کند مناسب است — NVIDIA، AMD، Intel Arc. همچنین فرآیندهای رونویسی و ترجمه هر کدام پردازنده مخصوص خود را دارند، بنابراین یکی میتواند روی کارت گرافیک اجرا شود در حالی که دیگری روی CPU اجرا میشود.
دانلود افزونههای اختیاری به درخواست، از طریق بخش Settings → Models:
Forced Aligner (~۵۴۰ مگابایت) برای زمانبندی سطح کلمه · Hunyuan MT2 Fast (~۱ گیگابایت) یا کیفیت (~۴.۳ گیگابایت) برای ترجمه.
| ویژگی | Brethof Voice Pro | Dragon | Google STT | Otter.ai | Whisper (OSS) |
|---|---|---|---|---|---|
| پردازش ۱۰۰٪ محلی | ✓ | ✓ | ✗ | ✗ | ✓ |
| مجوز دائمی | ✓ | ~ | ✗ | ✗ | ✓ |
| پشتیبانی بومی از Linux | ✓ | ✗ | ~ | ✗ | ✓ |
| پشتیبانی بومی از Windows | ✓ | ✓ | ~ | ✗ | ~ |
| ۳۰ زبان ASR + تشخیص خودکار | ✓ | ✗ | ✓ | ~ | ✓ |
| ترجمه آفلاین (۳۸ زبان) | ✓ | ✗ | ✗ | ✗ | ✗ |
| شتابدهی GPU (NVIDIA + AMD + Intel) | ✓ | ✗ | N/A | N/A | ~ |
| تنظیم دقیق مدل شخصی (LoRA) | ✓ | ✓ | ✗ | ✗ | ✗ |
| سرور MCP برای عاملهای هوش مصنوعی | ✓ | ✗ | ✗ | ✗ | ✗ |
| کاهش نویز داخلی | ✓ | ✓ | ✓ | ✓ | ✗ |
| تزریق مستقیم متن | ✓ | ✓ | ✗ | ✗ | ✗ |
| رابط کاربری دسکتاپ بهبودیافته | ✓ | ✓ | ✗ | ✓ | ✗ |
| هزینه معمولی | $49 یک بار | ۳۵۰ دلار/سال و بیشتر | ۱۷ دلار در ماه | ۱۷ دلار در ماه | رایگان |
بدون هزینه ماهانه. بدون محدودیت استفاده. مجوز دائمی همراه با ۱ سال بهروزرسانی.
نیازی به کارت اعتباری نیست؛ فقط کافی است برای تأیید نسخه آزمایشی، ایمیل خود را وارد کنید.
مجوز دائمی؛ ۲ دستگاه شخصی؛ بهروزرسانیهای ۱ ساله را شامل میشود.
قیمتها بدون مالیات است. هزینه بهروزرسانیها ۲۰ دلار در سال است (اختیاری).
مجوز دائمی (Per-seat). استفاده تیمی و سازمانی. ۱ سال بهروزرسانی.
قیمتها بدون مالیات است. سپس ۲۰ دلار/کاربر/سال برای بهروزرسانیها (اختیاری)
خیر. Brethof Voice Pro تمامی فرآیندها را بهصورت محلی روی دستگاه شما انجام میدهد. هیچ داده صوتی یا متنی از کامپیوتر شما خارج نمیشود. هیچ بخش ابری، اطلاعات پایشی یا تحلیلی وجود ندارد.
هر GPU مدرنی قابل استفاده است. کارتهای NVIDIA، AMD و Intel Arc همگی از شتاب Vulkan استفاده میکنند. همچنین میتوانید فقط با CPU اجرا کنید، هرچند رونویسی کندتر خواهد بود. مدل ۰.۶B به راحتی روی گرافیک یکپارچه یا هر کارت Vulkan با ۴ گیگابایت یا بیشتر کار میکند.
با مدل ۰.۶B — این گزینه پیشفرض توصیهشده است و روی اکثر GPUها (و حتی CPU در اکثر دستگاههای مدرن) عملکرد خوبی دارد. اگر برای صداهای دارای لهجه یا نویز دقت بالاتری میخواهید، به مدل ۱.۷B (نیاز به ۶ گیگابایت VRAM یا بیشتر دارد). میتوانید هر زمان از Settings → Models بدون دانلود مجدد، اندازه مدل را تغییر دهید.
بله. Brethof Voice Pro بهطور بومی از Linux و Windows پشتیبانی میکند. در Linux با X11 و Wayland کار میکند و در Windows بهعنوان یک برنامه دسکتاپ استاندارد اجرا میشود.
مجوز شما دائمی است؛ این برنامه همواره با هر نسخهای که دارید کار خواهد کرد. پکیج اختیاری Update Pass به قیمت ۲۰ دلار در سال، دسترسی شما را به ویژگیهای جدید و بهبودهای مربوط به مدلها فراهم میکند. بدون آن، شما همچنان در نسخه فعلی خود باقی خواهید ماند.
بله — آموزش صدای شخصی در نسخه ۲.۰.۰ گنجانده شده و بهطور کامل روی دستگاه شما اجرا میشود. هر بار که یک کلمه اشتباه تشخیصدادهشده را اصلاح میکنید، جفت {clip, correction} بهطور خودکار در مجموعه داده آموزشی محلی شما ذخیره میشود. کارت آموزش در پنجره اصلی، تعداد کل نمونهها و دقایق ضبطشده را در یک نگاه نشان میدهد — برای تنظیم دقیق LoRA بر اساس لهجه خود، روی «شروع آموزش» در تب Training کلیک کنید. نتیجه بهطور خودکار به فرمت GGUF صادر میشود و با یک کلیک به آن سوئیچ میکنید. این قابلیت برای هر مجوز پرداختی رایگان است و دادههای صدای شما هرگز از دستگاه شما خارج نمیشود.
۱۴ روز آزمایش رایگان. بدون کارت اعتباری. بدون ابر. بدون هیچ سازشی.
سیستم تبدیل گفتار به متن محلی که صدای شما را یاد میگیرد؛ مجوز دائمی. محصول پرچمدار ما.
پرداختی · مدل پرچمدار
حافظه بلندمدت برای ایجنتهای هوش مصنوعی شما — متن کامل + بردارها + نمودارها. در ابتدای جلسه اطلاعات آن ارائه میشود، با هر درخواستی دوباره فراخوانی میگردد و بهطور خودکار ذخیره میشود.
پرداختی · سطح رایگان
مدلهای دیجیتال آماده چاپ. شامل فرمتهای GLB و OBJ. دسترسی تمامعمر.
پرداختی · کاتالوگ دیجیتال
پنج دستگاه چاپگر و ظرفیت واقعی. هنوز فروشگاه خودخدمتی وجود ندارد — نیازهایتان را به ما بگویید و ما قیمت را از طریق ایمیل ارسال خواهیم کرد.
بنا بر توافق · به ما ایمیل بفرستید
کانال YouTube ما. یک مجری «ببر سایبری» ابزارهای هوش مصنوعی محلی و عملکرد واقعی آنها را توضیح میدهد.
کانال · پخش زنده
فهرستهای برگزیدهشده در GitHub برای ابزارهای کدنویسی هوش مصنوعی، سرورهای MCP، هوش مصنوعی محلی و Linux برای هوش مصنوعی. هر مورد دارای لینک منبع است.
رایگان · انتخابشده
راهنمایهای مفصل برای هوش مصنوعی محلی در Linux، Windows و macOS، همراه با فایلهای پیکربندی.
رایگان · زنده
گزینش منفی: روشها و ابزارهایی که وقت شما را تلف میکنند، رتبهبندیشده. مستندات لازم است.
رایگان · زنده
ما چه کسی هستیم، چرا هوش مصنوعی مبتنی بر حریم خصوصی میسازیم، و چه کارهایی را انجام نمیدهیم.