Bạn đang nói chuyện. Những từ ngữ ấy sẽ xuất hiện – trên trình soạn thảo văn bản, trên terminal, trong khung chat, trên biểu mẫu, bất cứ nơi nào mà con trỏ đang ở. Và mỗi từ trong số chúng đều sẽ còn lại trên máy tính nơi bạn đã phát ra chúng.
Brethof Voice Pro là công cụ chuyển giọng nói thành văn bản và dịch thuật, hoạt động hoàn toàn trên máy tính của bạn. Đó không phải là tính năng bảo mật, mà chính là toàn bộ chức năng của sản phẩm này.
Một chương trình, công suất của bốn người. Nó ghi âm giọng nói của bạn, dịch sang 38 ngôn ngữ, thêm phụ đề cho video, và gõ văn bản thay bạn ở bất cứ đâu cần sử dụng bàn phím. Chương trình này hoạt động ngoại tuyến – trên máy bay, trong khách sạn có mạng yếu, dưới lòng đường – và trên chiếc laptop mà bạn đã có, dù có card đồ họa hay không. Không cần đăng ký. Không tính phí theo phút. Không cần tải lên mạng. Hãy trang bị cho trợ lý AI của bạn “đôi tai” nữa: nó có thể ghi âm, dịch và ghi lại các cuộc họp với bất kỳ thời lượng nào thông qua MCP, trên máy của bạn, mà không cần khóa API. Mua một lần là có thể sử dụng mãi.
Giọng nói của bạn sẽ không bao giờ rời khỏi máy tính của bạn. Câu nói đó rất chính xác. Khi phần mềm được khởi động, chỉ có ba thứ được gửi lên mạng: kiểm tra giấy phép, kiểm tra phiên bản, và các mô hình mà người dùng tự tải về. Kiểm tra giấy phép gửi đi mã giấy phép; kiểm tra phiên bản gửi đi chuỗi thông tin về phiên bản phần mềm – hoàn toàn không có âm thanh hay văn bản nào cả. Nếu tắt chức năng kiểm tra phiên bản đi, thì một khi các mô hình đã được lưu trên ổ đĩa, sẽ không còn gì được gửi ra ngoài nữa.
Chuyển tự sang hơn 30 ngôn ngữ, đồng thời hiểu được 22 phương ngữ Trung Quốc một cách tự động — không cần thiết lập, không cần huấn luyện. Giọng nói của bạn cũng sẽ không còn bị sai nữa. Brethof Voice Pro sẽ tự học giọng nói, thuật ngữ chuyên môn và tên riêng của bạn trên chính chiếc máy của bạn. Dù bạn nói bằng phương ngữ Tứ Xuyên của bà mình, kết quả vẫn sẽ chính xác.
Nói tiếng Ba Lan, đọc tiếng Anh. Nói tiếng Anh, đọc tiếng Nhật. Hoặc nói một lần và yêu cầu văn bản được gõ ra bằng tiếng Anh, tiếng Nhật, tiếng Pháp và tiếng Tây Ban Nha cùng lúc — mỗi ngôn ngữ một dòng, hoặc xếp cạnh nhau trong cùng một dòng. Bạn có thể chọn bao nhiêu ngôn ngữ đích tùy thích; có tổng cộng 38 ngôn ngữ, trong đó 23 ngôn ngữ hỗ trợ dịch hai chiều. Quá trình dịch cũng diễn ra trên máy của bạn, sử dụng công cụ Hunyuan MT2 của Tencent. Với chất lượng hiện tại, nó đạt 97,9% so với Gemini 3.1 Pro của Google trên bài kiểm tra FLORES-200, và vượt trội hơn trong việc dịch các ngôn ngữ ít người sử dụng cũng như trong các tình huống dịch thực tế. Có hai phiên bản, cả hai đều có thể tải về tùy chọn: phiên bản nhanh dành cho việc sử dụng hàng ngày, phiên bản chất lượng cao dành cho những nội dung quan trọng. Cũng hỗ trợ dịch phụ đề. Dưới dạng văn bản thông thường hoặc SRT, theo từng câu, hoặc từng từ nếu bạn cần chỉnh sửa chính xác. Dịch một tập tin phụ đề mà mọi thời lượng phát vẫn được giữ nguyên. Tạo phụ đề cho video của ri
Đó chính là lý do tại sao nó hoạt động được ở những nơi mà các phương pháp khác không thể hoạt động được. Một chiếc máy bay, một khách sạn có mạng Wi-Fi kém, một chuyến tàu đi qua đường hầm… Không có nơi nào để lưu trữ dữ liệu ghi âm cả, vì vậy nó cũng không cần phải gửi dữ liệu đi đâu cả. Bạn chỉ cần ghi lại nội dung cuộc họp kéo dài hai giờ rồi đi pha cà phê; bản ghi chép sẽ có sẵn khi bạn quay lại. Bạn có thể quên mất rằng mình đã để máy ghi âm hoạt động, và mọi thứ vẫn được lưu giữ nguyên vẹn – nó tự động hoàn thành công việc và lưu lại bản ghi chép.
Có hai mô hình chuyển dịch văn bản; đó là sự lựa chọn, chứ không phải các cấp độ khác nhau – bạn có thể thay đổi chúng bất cứ lúc nào.
Hầu hết các phần mềm xử lý giọng nói đều yêu cầu người dùng đọc những câu mẫu trong quá trình cài đặt. Nhưng phần mềm này thì không. Nó học hỏi từ những sửa chữa mà người dùng thực hiện: khi bạn sửa một từ bị nghe nhầm, thì lần sửa đó sẽ trở thành ví dụ dùng để huấn luyện. Chỉ cần nhập một lần tên thương hiệu, thuật ngữ chuyên môn, hoặc tên đồng nghiệp của bạn, chúng sẽ không còn bị viết sai nữa – cả trong bản ghi âm lẫn bản dịch – vì cùng một danh sách sẽ được sử dụng cho cả hai. Tên gì cũng sẽ không bao giờ bị dịch sai một cách tình cờ. Quá trình huấn luyện chỉ cần một cú nhấp chuột; nó diễn ra trên phần cứng của bạn, và mô hình mới sẽ sẵn sàng được sử dụng ngay khi quá trình huấn luyện kết thúc.
Mua một lần là có thể sử dụng mãi. Đó là giấy phép vĩnh viễn, kèm theo 1 năm cập nhật miễn phí.
Căn phòng ồn ào sẽ không còn là vấn đề nữa. Chức năng giảm tiếng ồn được tích hợp sẵn, dành cho các cuộc ghi âm được thực hiện tại quán cà phê, hội chợ, hoặc trong xe hơi. Chức năng này được tắt theo mặc định, vì chúng tôi đã kiểm tra: trên những đoạn ghi âm ngắn và sạch, nó lại khiến tình hình tồi tệ hơn. Đối với những cuộc họp kéo dài hai giờ với chiếc máy pha cà phê ở phía sau bạn, hãy bật chức năng này lên.
Bàn phím giọng nói có thể gõ ở bất kỳ vị trí nào mà Cursor đang ở – trên trình duyệt, IDE, ứng dụng chat, hoặc bất kỳ ô nào chấp nhận bàn phím. Nó có thể gõ kết quả dịch thay vì bản phiên âm. Hãy nói câu bằng ngôn ngữ của bạn, và những từ phù hợp sẽ được hiển thị trong định dạng yêu cầu, bằng ngôn ngữ đó. Chỉ một dòng, không cần cắt dán.
Phiên bản 0.6B là phiên bản được sử dụng hàng ngày. Nó có thể hoạt động trên bất kỳ card đồ họa nào có dung lượng 4 GB, trên các card đồ họa tích hợp, và cả trên những chiếc máy tính xách tay không có card đồ họa nữa. Nhanh, gọn nhẹ, và luôn sẵn sàng khi bạn cần.
Phiên bản 1,7 tỷ là lựa chọn phù hợp nhất – dành cho các tập tin âm thanh có dấu nhấn, âm thanh nhiễu, hoặc những cuộc họp kéo dài hai giờ mà từng từ đều rất quan trọng. Nó yêu cầu khoảng 6 GB VRAM; nếu sử dụng mô hình dịch chất lượng cao thì cần 8 GB VRAM.
Không có GPU à? Vẫn có thể chạy được. Chế độ chỉ sử dụng CPU yêu cầu 8 GB RAM, bộ xử lý bốn nhân, và khoảng 5 GB dung lượng ổ cứng trống; các yêu cầu khác là từ 7–9 GB. Bất kỳ card đồ họa nào hỗ trợ Vulkan 1.2+ đều có thể sử dụng — NVIDIA, AMD, Intel Arc. Việc ghi âm và dịch văn bản mỗi loại sẽ sử dụng một bộ xử lý riêng, vì vậy một công việc có thể chạy trên card đồ họa trong khi công việc còn lại chạy trên CPU.
Có thể tải các phần mở rộng tùy chọn theo yêu cầu từ Cài đặt → Mô hình:
Forced Aligner (~540 MB) cho thời gian đánh dấu cấp độ từ · Hunyuan MT2 Fast (~1 GB) hoặc Chất lượng (~4,3 GB) cho việc dịch.
| Tính năng | Brethof Voice Pro | Dragon | Google STT | Otter.ai | Whisper (OSS) |
|---|---|---|---|---|---|
| Xử lý 100% cục bộ | ✓ | ✓ | ✗ | ✗ | ✓ |
| Giấy phép vĩnh viễn | ✓ | ~ | ✗ | ✗ | ✓ |
| Hỗ trợ Linux gốc | ✓ | ✗ | ~ | ✗ | ✓ |
| Hỗ trợ Windows gốc | ✓ | ✓ | ~ | ✗ | ~ |
| 30 ngôn ngữ ASR + tự nhận diện | ✓ | ✗ | ✓ | ~ | ✓ |
| Dịch ngoại tuyến (38 ngôn ngữ) | ✓ | ✗ | ✗ | ✗ | ✗ |
| Tăng tốc GPU (NVIDIA + AMD + Intel) | ✓ | ✗ | N/A | N/A | ~ |
| Tinh chỉnh mô hình cá nhân (LoRA) | ✓ | ✓ | ✗ | ✗ | ✗ |
| Máy chủ MCP dành cho agent AI | ✓ | ✗ | ✗ | ✗ | ✗ |
| Giảm nhiễu tích hợp | ✓ | ✓ | ✓ | ✓ | ✗ |
| Chèn văn bản trực tiếp | ✓ | ✓ | ✗ | ✗ | ✗ |
| Giao diện máy tính để bàn trau chuốt | ✓ | ✓ | ✗ | ✓ | ✗ |
| Chi phí điển hình | $49 một lần | $350+/năm | $17/tháng | $17/tháng | Miễn phí |
Không phí hàng tháng. Không giới hạn sử dụng. Giấy phép vĩnh viễn kèm 1 năm cập nhật.
Không cần thẻ tín dụng. Chỉ cần email để xác minh dùng thử.
Giấy phép vĩnh viễn. 2 thiết bị cá nhân. Bao gồm 1 năm cập nhật.
Giá chưa bao gồm thuế. Phí cập nhật (tùy chọn) là 20 đô la/năm.
Giấy phép vĩnh viễn (theo mỗi người dùng). Dành cho nhóm và tổ chức. 1 năm cập nhật.
Giá chưa bao gồm thuế. Sau đó là $20/người dùng/năm cho bản cập nhật (tùy chọn).
Không. Brethof Voice Pro xử lý mọi thứ ngay trên thiết bị của bạn. Không có dữ liệu âm thanh hay văn bản nào rời khỏi máy tính của bạn cả. Không có thành phần dựa trên đám mây, không có việc thu thập dữ liệu từ xa, và cũng không có chức năng phân tích dữ liệu.
Bất kỳ GPU hiện đại nào cũng hoạt động được. Các dòng NVIDIA, AMD và Intel Arc đều sử dụng tăng tốc Vulkan. Bạn cũng có thể chạy chỉ trên CPU, mặc dù tốc độ chuyển đổi văn bản sẽ chậm hơn. Mô hình 0.6B hoạt động tốt trên card đồ họa tích hợp hoặc bất kỳ card Vulkan nào có dung lượng 4 GB trở lên.
Bắt đầu với Mô hình 0,6B — Đây là tùy chọn mặc định được khuyến nghị, và hoạt động rất tốt trên hầu hết các GPU (và thậm chí cả trên CPU của những máy tính hiện đại). Nếu bạn cần độ chính xác cao hơn đối với âm thanh có giọng địa phương hoặc bị nhiễu, hãy chuyển sang Mô hình 1,7B (cần 6 GB+ VRAM). Bạn có thể thay đổi kích thước bất cứ lúc nào từ Cài đặt → Mô hình mà không cần tải lại.
Vâng. Brethof Voice Pro hỗ trợ cả Linux lẫn Windows một cách tự nhiên. Trên Linux, nó hoạt động tốt với cả X11 và Wayland. Trên Windows, nó chạy như một ứng dụng máy tính để bàn thông thường.
Giấy phép của bạn là vĩnh viễn — ứng dụng sẽ tiếp tục hoạt động mãi với bất kỳ phiên bản nào bạn đang có. Gói Update Pass tùy chọn giá $20/năm cho phép bạn truy cập các tính năng mới và cải tiến mô hình. Nếu không mua, bạn chỉ sử dụng phiên bản hiện tại.
Vâng — chức năng luyện giọng cá nhân có sẵn trong phiên bản v2.0.0 và được xử lý hoàn toàn trên máy của bạn. Mỗi lần bạn sửa một từ bị nhận diện sai, cặp dữ liệu {clip, correction} sẽ tự động được lưu vào tập dữ liệu huấn luyện cục bộ của bạn. Thẻ huấn luyện trên giao diện chính hiển thị ngay tổng số mẫu và thời gian ghi âm — hãy nhấp vào “Bắt đầu huấn luyện” trong tab Huấn luyện để tinh chỉnh mô hình LoRA phù hợp với giọng nói của bạn. Kết quả sẽ được xuất tự động dưới định dạng GGUF và bạn có thể chuyển sang sử dụng nó chỉ với một cú nhấp chuột. Dịch vụ này miễn phí đi kèm mọi giấy phép trả phí, và dữ liệu giọng nói của bạn sẽ không bao giờ rời khỏi máy của bạn.
14 ngày dùng thử miễn phí. Không cần thẻ tín dụng. Không dùng đám mây. Không thỏa hiệp.
Chuyển đổi giọng nói thành văn bản cục bộ, học giọng nói của bạn. Giấy phép vĩnh viễn. Sản phẩm chủ lực của chúng tôi.
CÓ PHÍ · sản phẩm chủ lực
Bộ nhớ dài hạn cho các agent AI của bạn — văn bản đầy đủ + vector + đồ thị. Được cung cấp ngay khi bắt đầu phiên, được gọi lại mỗi khi có yêu cầu, và được lưu trữ tự động.
Đã trả phí · gói miễn phí
Mô hình kỹ thuật số sẵn sàng in. Bao gồm GLB và OBJ. Truy cập trọn đời.
CÓ PHÍ · danh mục kỹ thuật số
Năm máy in với công suất thực sự mạnh mẽ. Hiện chưa có dịch vụ tự phục vụ – hãy cho chúng tôi biết nhu cầu của bạn và chúng tôi sẽ gửi báo giá qua email.
Theo thỏa thuận · Gửi email cho chúng tôi
Kênh YouTube của chúng tôi. Một người dẫn chương trình kiểu “hổ mạng” sẽ giới thiệu về các công cụ AI địa phương và chức năng thực sự của chúng.
KÊNH · trực tiếp
Các danh sách được tuyển chọn trên GitHub dành cho các công cụ lập trình AI, các máy chủ MCP, các giải pháp AI cục bộ và Linux dành cho AI. Mỗi mục đều có liên kết nguồn.
MIỄN PHÍ · được tuyển chọn
Hướng dẫn chi tiết về cách triển khai AI cục bộ trên Linux, Windows và macOS, kèm theo các tệp cấu hình.
MIỄN PHÍ · trực tiếp
Curate tiêu cực: các phương pháp và công cụ lãng phí thời gian, được xếp hạng. Cần bằng chứng.
MIỄN PHÍ · trực tiếp
Chúng tôi là ai, tại sao chúng tôi xây dựng trí tuệ nhân tạo coi trọng quyền riêng tư, và những điều chúng tôi sẽ không làm.