Hai công nghệ này làm hai việc ngược nhau: một bên chuyển lời nói thành văn bản, một bên chuyển văn bản thành lời nói. Cả hai đều xuất hiện trong nhiều công cụ học ngôn ngữ nên biết giới hạn của chúng có ích.
- Nhận diện giọng nói chuyển âm thanh thành văn bản.
- Tổng hợp giọng nói chuyển văn bản thành âm thanh.
- Nhận diện giọng nói yếu đi rõ khi có tiếng ồn hoặc giọng không phổ biến.
- Cả hai đều không đánh giá được phát âm của bạn một cách đầy đủ.
Hai công nghệ và chiều chuyển đổi
Hai công nghệ dưới đây được dùng trong nhiều công cụ học ngôn ngữ. Điểm quan trọng với người học: chúng làm nhiệm vụ chuyển đổi định dạng chứ không phải nhiệm vụ đánh giá — và việc một hệ thống nhận ra được từ bạn nói không có nghĩa là bạn phát âm chuẩn.
Vì sao chúng không đánh giá được phát âm đầy đủ
Nhiều ứng dụng học ngôn ngữ có tính năng chấm phát âm dựa trên nhận diện giọng nói, và người học dễ hiểu nhầm kết quả. Cơ chế của những tính năng này thường là kiểm xem hệ thống có nhận ra được từ bạn định nói hay không, và mức độ khớp với mẫu. Điều này bắt được những lỗi lớn nhưng bỏ qua nhiều thứ: nó ít nhạy với trọng âm đặt sai, với ngữ điệu không tự nhiên, và với những sai lệch nhỏ mà người bản ngữ nhận ra ngay. Ngoài ra, hệ thống được thiết kế để nhận ra được nhiều giọng khác nhau, nên nó khoan dung hơn tai người. Vì vậy chấm phát âm tự động hữu ích ở giai đoạn đầu nhưng không thay được người nghe.
Ứng dụng và giới hạn với người học
Bốn ứng dụng dưới đây có ích thật. Ứng dụng thứ ba đáng chú ý và ít người dùng: cho hệ thống đọc chính đoạn văn bạn vừa viết giúp bạn nghe ra những chỗ diễn đạt lủng củng mà đọc bằng mắt không phát hiện.
Sai lầm thường gặp
- Coi kết quả chấm phát âm tự động như đánh giá đầy đủ về phát âm của mình.
- Tin phụ đề tự động khi âm thanh có tiếng ồn hoặc giọng ít phổ biến.
- Dùng giọng tổng hợp làm mẫu duy nhất thay vì nghe người thật.
Câu hỏi thường gặp
Chấm phát âm tự động có đáng tin không?
Đáng tin ở mức bắt lỗi lớn và cho phản hồi tức thì, rất hữu ích ở giai đoạn đầu. Nhưng nó không nhạy với trọng âm và ngữ điệu nên không thay được người nghe.
Vì sao hệ thống nhận ra tôi mà người bản ngữ vẫn thấy lạ?
Vì hệ thống được thiết kế để khoan dung với nhiều giọng khác nhau, nên nó nhận ra được cả những cách phát âm mà tai người thấy không tự nhiên.
Giọng tổng hợp có dùng làm mẫu được không?
Được cho việc kiểm cách đọc một từ, nhưng nên kết hợp với giọng người thật cho phần ngữ điệu và nhịp. Chất lượng giọng tổng hợp cũng khác nhau nhiều giữa các ngôn ngữ.
Phụ đề tự động có dùng để học được không?
Dùng được nhưng nên đối chiếu, vì nó sai khá nhiều trong điều kiện có tiếng ồn hoặc giọng ít phổ biến. Đừng dùng nó làm căn cứ duy nhất khi bạn không nghe rõ.