Hôm nay, Brethof Voice Pro v1.0 đã có sẵn để tải xuống trên Windows 10/11 và Linux (Ubuntu, Fedora, Arch). Đây là ứng dụng máy tính để bàn, thu âm từ micrô của bạn và chạy mô hình ASR dựa trên Qwen. cục bộ trên CPU hoặc GPU của bạn, và gõ văn bản đã chuyển tự vào bất kỳ cửa sổ nào bạn đang tập trung.
Những gì có trong bản phát hành v1.0
- 30 ngôn ngữ nhận diện giọng nói và 38 ngôn ngữ dịch — Tiếng Ả Rập, Tiếng Quảng Đông, Tiếng Trung, Tiếng Séc, Tiếng Đan Mạch, Tiếng Hà Lan, Tiếng Anh, Tiếng Filipino, Tiếng Phần Lan, Tiếng Pháp, Tiếng Đức, Tiếng Hy Lạp, Tiếng Hindi, Tiếng Croatia, Tiếng Hungary, Tiếng Indonesia, Tiếng Ý, Tiếng Nhật, Tiếng Hàn, Tiếng Macedonia, Tiếng Mã Lai, Tiếng Ba Tư, Tiếng Ba Lan, Tiếng Bồ Đào Nha, Tiếng Romania, Tiếng Nga, Tiếng Serbia, Tiếng Slovakia, Tiếng Slovenia, Tiếng Tây Ban Nha, Tiếng Thụy Điển, Tiếng Thái, Tiếng Thổ Nhĩ Kỳ, Tiếng Ukraine, Tiếng Việt, Tiếng Bulgaria.
- Ghi chú bằng phím tắt toàn hệ thống — Nhấn phím tắt ở bất kỳ đâu, nói, thả ra, và văn bản được gõ vào ứng dụng đang được chọn.
- 100% ngoại tuyến — Không đám mây, không telemetry, không cần tài khoản để chuyển tự.
- Ba cấp độ mô hình — cơ bản (nhanh, 0,6B tham số), trung bình (1,7B), lớn (3B). Chọn tùy theo phần cứng của bạn.
- Giảm nhiễu qua DeepFilterNet và phát hiện hoạt động giọng nói qua Silero VAD, cả hai đều chạy cục bộ.
- Từ khóa — Chèn tên, từ viết tắt và thuật ngữ chuyên ngành dưới dạng gợi ý trong lúc suy luận (không cần huấn luyện lại).
Một công cụ không Trong phiên bản 1.0: tinh chỉnh mô hình. Các bản dựng trước đó có tính năng này qua PyTorch, nhưng khi chúng tôi chuyển suy luận sang GGUF, quy trình huấn luyện bị hỏng và chúng tôi sẽ không phát hành cho đến khi bước chuyển đổi ổn định. Xem Kế hoạch điều chỉnh chi tiết sau này.
Giá cả
Mua một lần, không đăng ký thuê bao:
- Personal — 2 máy, bao gồm việc sử dụng thương mại của cá nhân và người làm việc tự do. Xem giá.
- Business — sử dụng cho nhóm/tổ chức với giảm giá theo khối lượng từ 10 ghế trở lên. Xem giá.
- Dùng thử miễn phí 14 ngày — Không cần thẻ tín dụng, mọi tính năng đều được mở khóa.
Giá cả sẽ tự điều chỉnh tùy theo khu vực: nếu bạn ở Đông Âu, Đông Nam Á, Mỹ Latinh hoặc châu Phi, bạn sẽ thấy mức giá được tính dựa trên nguyên tắc sức mua tương đương.
Những gì chúng tôi đã làm đúng
Điều khiến chúng tôi hài lòng nhất là thời gian đến từ đầu tiên. Mở ứng dụng, nhấn phím tắt, rồi nói. Không cần đăng ký. Không cần trình duyệt. Không cần tải lên. Không cần chờ đợi quá trình xử lý trên đám mây. Trên một chiếc máy tính xách tay tầm trung, Voice Pro với mô hình cơ bản có thể chuyển một câu năm giây thành văn bản trong chưa đến 400 ms. Tốc độ này chính là mục tiêu cốt lõi.
Những gì tiếp theo
- Bản dựng macOS — đang trong quá trình phát triển, dự kiến hoàn thành vào quý 3 năm 2026.
- Tinh chỉnh theo giọng nói và từ vựng của bạn — Sẽ được thực hiện khi quy trình chuyển đổi từ PyTorch sang GGUF sẵn sàng. Mục tiêu là quý 3 năm 2026.
- Chế độ phát trực tiếp thời gian thực — Các từ xuất hiện khi bạn nói, không phải sau khi bạn thả phím tắt.
- Nhiều cấp độ mô hình hơn — một mô hình thiết bị biên siêu nhỏ dành cho phần cứng cấu hình thấp, và một mô hình 7B dành cho các máy mạnh.
Nếu bạn đã chờ đợi một công cụ ghi chú tôn trọng quyền riêng tư, thì hôm nay là ngày đó. Tải bản dùng thử, ghi chú trong 14 ngày, cho chúng tôi biết nó hỏng ở đâu. Chúng tôi đọc từng email.