Chuyển văn bản thành giọng nói miễn phí, không đăng ký
13 giọng studio tiếng Việt, và cả giọng của chính bạn. Tải MP3 không watermark.
Tải lên một mẫu 3–8 giây, giọng sẽ hiện ngay trong ô chọn giọng ở trên và được chọn sẵn. Chỉ mình bạn dùng được.
Giọng bạn tạo chỉ mình bạn dùng, mã giọng chỉ nằm trong trình duyệt này. Xem chi tiết
- 13
- giọng studio tiếng Việt
- 500
- từ mỗi lượt
- 0đ
- trọn đời, không đăng ký
Giọng thu phòng thu, không phải giọng thu bằng micro bất kỳ
Đường sóng bên cạnh mỗi giọng là biên độ đo từ chính tệp bạn sắp nghe, không phải hình vẽ minh hoạ. Bấm Dùng để đưa giọng lên máy ở trên.
- Ngọc HuyềnNỮ · 6.6s
- Quang MinhNAM · 7.4s
- Đức ThịnhNAM · 7.6s
- Anh ThứcNAM · 6.8s
- Tuấn KhangNAM · 6.6s
- Tùng LâmNAM · 7.9s
- Hoàng BìnhNAM · 6.2s
- Minh TuyênNAM · 7.7s
- Hà LyNỮ · 7.0s
- Bảo NgọcNỮ · 7.9s
- Mỹ ĐoanNỮ · 8.3s
- Gia VĩnhNAM · 6.8s
- Thanh MaiNỮ · 9.6s
Tải một mẫu 3 giây, có ngay giọng của bạn
Không công cụ miễn phí nào ở trang đầu Google cho làm việc này. Giọng bạn tạo chỉ mình bạn dùng: enhsa không có kho giọng chung, và mã giọng chỉ nằm trong trình duyệt của bạn.
- 01
Ô tải mẫu đã mở sẵn ngay dưới ô chọn giọng ở đầu trang. Tải lên một mẫu 3–8 giây: một người nói, rõ tiếng, không nhạc nền.
- 02
Máy học giọng trong khoảng mười giây. Xong là giọng hiện ngay trong ô chọn giọng và được chọn sẵn cho bạn.
- 03
Dùng nó như mọi giọng khác — kể cả cho ngoại ngữ, tuy khi đó nó vẫn giữ chất giọng trong mẫu bạn tải lên.
- 04
Bấm Xoá bất cứ lúc nào để gỡ giọng khỏi máy này và yêu cầu máy chủ quên mẫu đã tải lên.
Mẫu tối đa 2 MB, mỗi ngày tạo tối đa 5 giọng từ một địa chỉ IP. Giọng bạn tạo mang một mã ngẫu nhiên chỉ nằm trong bộ nhớ của chính trình duyệt này: enhsa không có kho giọng chung, không cửa nào liệt kê mã đó ra, và không có đường nào đưa giọng của bạn ra công khai. Đổi lại, xoá dữ liệu duyệt web hoặc sang máy khác thì bạn sẽ không thấy giọng đã tạo nữa.
Ngoại ngữ đọc bằng giọng người bản xứ
48 ngôn ngữ có giọng dựng từ mẫu do chính người bản xứ đọc, nên nghe ra đúng tiếng đó chứ không phải tiếng Việt nói ngoại ngữ. Máy nhận dạng tiếng nói đã kiểm từng giọng trước khi đưa lên đây. Ngôn ngữ ngoài danh sách vẫn tạo được, nhưng công cụ sẽ báo trước là giọng sẽ mang chất Việt.
Bốn bước, khoảng một phút
- 01
Dán chữ
Dán đoạn văn bạn muốn nghe vào ô soạn thảo, tối đa 500 từ mỗi lượt.
- 02
Chọn giọng
Nghe thử 13 giọng studio, hoặc tải mẫu lên để tạo giọng của riêng bạn.
- 03
Bấm tạo
Máy đọc xong trong khoảng 17 giây cho một đoạn 500 từ.
- 04
Tải MP3
Nghe lại rồi tải tệp MP3 về máy. Không watermark, dùng cho việc gì cũng được.
Đặt cạnh các công cụ miễn phí khác
Số liệu đọc từ trang chính thức của từng công cụ, ngày 28/08/2026.
| Tiêu chí | enhsa | ttsfree | luvvoice | everai |
|---|---|---|---|---|
| Miễn phí mỗi lượt | 500 từ | 500 ký tự | 3.000 ký tự | 500 ký tự |
| Trần theo tháng | không có | 500.000 ký tự | 20.000 ký tự | phải đăng nhập |
| Tạo giọng riêng | có | không | không | không |
| Cần đăng ký | không | không (2.000 ký tự nếu đăng nhập) | có | có |
Những điều hay được hỏi
Dùng enhsa có mất tiền không?
Không. Không có gói trả phí, không có bản nâng cấp, không có thẻ tín dụng. Giới hạn là 500 từ mỗi lượt, mỗi lượt cách nhau 5 giây, và một số lượt nhất định mỗi ngày cho một địa chỉ IP — đủ rộng cho người dùng thật, chỉ để một GPU phục vụ được nhiều người cùng lúc.
Có cần tạo tài khoản không?
Không cần. Mở trang là dùng được ngay, không có bước đăng ký hay xác minh email.
Vì sao mỗi lượt phải cách nhau 5 giây?
Vì giọng được sinh bằng GPU thật chứ không phải giọng máy ghép sẵn. Một đoạn 500 từ tốn khoảng 17 giây máy. Khoảng nghỉ 5 giây giữ cho một người bấm liên tục không chiếm hết chỗ của những người còn lại. Bấm dồn nhiều lượt trong ít phút thì trang sẽ giãn khoảng nghỉ ra, và luôn báo rõ còn bao nhiêu giây.
Giọng miễn phí có kém hơn bản trả phí không?
Không. enhsa dùng đúng mô hình và đúng mức chất lượng đang phục vụ khách trả tiền của cùng hệ thống, không có bản rút gọn cho người dùng miễn phí.
Tôi có được dùng file MP3 cho mục đích thương mại không?
Được. Tệp tải về không có watermark và không bị giới hạn mục đích sử dụng. Riêng giọng do bạn tự tải mẫu lên thì trách nhiệm về quyền sử dụng giọng đó thuộc về bạn.
Tạo giọng riêng cần mẫu dài bao nhiêu?
Từ 3 đến 8 giây là đủ. Mẫu nên nói rõ ràng, một người nói, không nhạc nền và không tiếng ồn. Mẫu dài hơn không cho kết quả tốt hơn.
Giọng tôi tải lên có bị người khác dùng không?
Không. enhsa không có kho giọng chung và không có nút nào để chia sẻ giọng ra công khai — chúng tôi đã bỏ hẳn tính năng đó. Mỗi giọng bạn tạo mang một mã ngẫu nhiên chỉ được lưu trong trình duyệt của bạn; không trang nào và không cửa nào của enhsa liệt kê mã đó ra, kể cả cho chính bạn. Đổi lại, nếu bạn xoá dữ liệu duyệt web hoặc sang máy khác thì sẽ không thấy giọng đã tạo nữa.
Vì sao enhsa không có kho giọng cộng đồng?
Vì muốn có kho chung thì phải có người kiểm từng mẫu giọng người lạ tải lên, mà enhsa không có người trực. Một câu như "giọng sẽ được kiểm trước khi hiện công khai" là lời hứa không ai giữ được: hoặc là một mẫu bậy hiện dưới tên miền này, hoặc là chẳng giọng nào từng được duyệt và ô tích chỉ để làm cảnh. Chúng tôi chọn bỏ hẳn đường công khai thay vì hứa một việc mình không làm nổi.
Vì sao chỉ có 13 giọng mà không phải hàng trăm?
Vì 13 giọng này là giọng thu phòng thu, không phải giọng đọc thu bằng micro bất kỳ. Kho cũ có 60 giọng nhưng đo ra sàn nhiễu cao hơn 17 decibel, nghe rõ tiếng ù. Cần thêm giọng thì bạn tự tạo giọng riêng, số lượng không giới hạn.
enhsa hỗ trợ những ngôn ngữ nào?
Tiếng Việt là thứ enhsa làm tốt nhất, với 13 giọng studio. Ngoài ra 48 ngôn ngữ có giọng do người bản ngữ đọc, dựng từ bộ mẫu FLEURS của Google. Mô hình nhận tổng cộng 646 mã ngôn ngữ, nhưng những mã ngoài 48 tiếng kia phải đọc bằng giọng clone từ mẫu tiếng Việt nên mang chất giọng Việt. Xem bản kê đầy đủ kèm giới hạn từng ngôn ngữ ở trang Ngôn ngữ.
Giọng đọc ngoại ngữ có chuẩn như người bản xứ không?
Với 48 ngôn ngữ thì có: giọng của chúng dựng từ mẫu do chính người bản ngữ đọc, và mỗi giọng phải qua thẩm định bằng máy nhận dạng tiếng nói — máy phải nghe ra đúng ngôn ngữ đó VÀ đọc lại đúng trên 55% số chữ thì giọng mới được đưa lên. Với các ngôn ngữ còn lại thì chưa: chúng đọc bằng giọng clone từ mẫu tiếng Việt, nói đúng chữ nhưng vẫn nghe ra chất giọng người Việt. Đo trên máy: tiếng Đức đọc đúng tới 95% số chữ mà máy nhận dạng vẫn xếp giọng đó vào nhóm tiếng Việt. Công cụ báo trước ngay khi bạn chọn một ngôn ngữ thuộc nhóm này.
Tải về được định dạng gì?
MP3. Đây là định dạng mở được trên mọi máy và mọi phần mềm dựng video.
enhsa có lưu nội dung tôi nhập không?
Tệp âm thanh được giữ tạm để bạn tải lại nếu bấm nhầm, và bị xoá tự động sau 24 giờ. Trang không có tài khoản, không hỏi email và không lưu đoạn văn bạn nhập kèm danh tính nào. Nói cho đủ: enhsa có dùng Google Analytics để đếm lượt truy cập, nên Google đặt cookie và ghi nhận những thứ thường lệ của một lượt xem trang — trang nào, thiết bị gì, đến từ vùng nào. Nội dung bạn gõ và tệp âm thanh bạn tạo KHÔNG được gửi sang đó.
Vì sao đôi khi trang báo đang bận?
Vì cả trang chạy trên một GPU duy nhất. Khi có quá nhiều người tạo cùng lúc, trang từ chối ngay và báo số giây nên chờ, thay vì để bạn chờ vô ích rồi lỗi.
Chữ số và ngày tháng có được đọc đúng không?
Tiếng Việt thì có — đã đo 6/6 lượt đọc đúng trên giọng mặc định. Các ngôn ngữ khác chưa được đo đủ để dám hứa, nên khi bạn chọn một ngôn ngữ chưa đo thì công cụ báo trước rằng chữ số có thể bị đọc sai. Cách chắc chắn nhất là viết số thành chữ trong văn bản trước khi tạo.