Chuyển giọng nói thành văn bản ⚠️ Có thể gửi âm thanh đến dịch vụ đám mây

Chuyển giọng nói trực tiếp trong trình duyệt

⚠ Trước khi bắt đầu: cách hoạt động thực sự

Tính năng nhận dạng giọng nói ở đây sử dụng Web Speech API tích hợp sẵn của trình duyệt — không phải một mô hình riêng tư chạy ngay trên thiết bị. Trên Chrome và hầu hết các trình duyệt nền Chromium, điều này có nghĩa là âm thanh của bạn được gửi đến máy chủ nhận dạng giọng nói của Google để xử lý. Điều này khác với mọi công cụ khác trên trang này, vốn chạy 100% cục bộ và không tải lên bất cứ thứ gì. Nếu quyền riêng tư của âm thanh quan trọng với nội dung bạn sắp nói, hãy kiểm tra cách trình duyệt cụ thể của bạn triển khai tính năng này trước khi dùng công cụ, hoặc tránh dùng nó cho nội dung nhạy cảm.

Không nghe

Bản chép lời

Nhấp vào "Bắt đầu nghe" và bắt đầu nói — lời nói của bạn sẽ hiện ở đây.

Về công cụ này

Công cụ này bao bọc Web Speech API gốc của trình duyệt để chuyển giọng nói thành văn bản trực tiếp, ngay trên trang này. Nhấp Bắt đầu, nói, và xem chữ xuất hiện khi bạn nói: văn bản tạm thời (đang được nhận dạng) hiển thị ở kiểu chữ nghiêng, nhạt hơn, rồi được chốt thành văn bản hoàn chỉnh khi trình duyệt chắc chắn là đúng. Chế độ liên tục tiếp tục lắng nghe qua những khoảng dừng tự nhiên thay vì dừng lại sau một câu, và bộ chọn ngôn ngữ cho phép bạn đổi ngôn ngữ nhận dạng cho khớp với ngôn ngữ bạn đang nói.

Khác với các công cụ khác trên trang này vốn chạy hoàn toàn ngoại tuyến ngay trong trình duyệt, tính năng nhận dạng giọng nói ở đây phụ thuộc vào dịch vụ nền của Web Speech API — và trên Chrome cùng các trình duyệt nền Chromium khác, điều đó có nghĩa là âm thanh của bạn được gửi qua mạng đến máy chủ của Google để xử lý. Firefox và Safari hiện hầu như không hỗ trợ API này, nên công cụ hoạt động tốt nhất trên trình duyệt nền Chromium. Nếu bạn sắp chép lời nội dung nhạy cảm, hãy cân nhắc sự đánh đổi này trước khi bắt đầu.

Câu hỏi thường gặp

Bản ghi âm giọng nói của tôi có riêng tư không?

Điều này hoàn toàn phụ thuộc vào trình duyệt của bạn, và đây là một ngoại lệ quan trọng so với cách mọi công cụ khác trên trang này hoạt động. Trong Chrome và hầu hết các trình duyệt dựa trên Chromium (Edge, Brave, v.v.), Web Speech API mà công cụ này sử dụng gửi âm thanh của bạn đến dịch vụ nhận dạng giọng nói trên đám mây (mặc định là của Google) để xử lý — nó KHÔNG hoàn toàn trên thiết bị như các công cụ khác trên trang này. Nếu quyền riêng tư âm thanh quan trọng với nội dung bạn đang chuyển đổi, hãy kiểm tra tài liệu/chính sách quyền riêng tư của trình duyệt cụ thể của bạn trước khi dùng công cụ này, hoặc cân nhắc dùng công cụ chuyển đổi hoàn toàn ngoại tuyến cho nội dung nhạy cảm.

Tại sao công cụ này không hoạt động trên trình duyệt của tôi?

Web Speech API mà công cụ này dựa vào là một tính năng của trình duyệt, không phải thứ mà trang này có thể tự thêm vào, và mức hỗ trợ của các trình duyệt thực sự không đồng đều: Chrome và hầu hết các trình duyệt dựa trên Chromium hỗ trợ tốt, trong khi Firefox hỗ trợ rất ít hoặc không hỗ trợ, và mức hỗ trợ của Safari trước nay bị giới hạn/không nhất quán giữa các phiên bản. Trang này tự động phát hiện điều này và hiển thị thông báo "không được hỗ trợ" rõ ràng thay vì âm thầm thất bại — nếu bạn thấy thông báo đó, hãy thử chuyển sang phiên bản Chrome hoặc Edge gần đây.