Voice Module — Tương Tác Giọng Nói (STT / TTS)

Module xử lý chuyển đổi giọng nói thành văn bản () và đọc văn bản thành giọng nói (), tối ưu cho người cao tuổi Việt Nam (tốc độ nói chậm, phát âm rõ ràng, hỗ trợ phương ngữ).


1. Cấu Trúc Thành Phần

  • stt/:
  • stt_service.py: Wrapper kết nối Google Cloud Speech-to-Text / Whisper.
  • transcript_confirmer.py: Cơ chế xác nhận lại nội dung phiên âm với người cao tuổi trước khi gửi đến hệ thống xử lý.
  • vietnamese_postprocess.py: Chuẩn hóa tiếng Việt, chỉnh sửa lỗi nhận diện tên vùng cơ khớp hay phát âm địa phương.
  • tts/:
  • tts_service.py: Wrapper chuyển đổi phản hồi của AI thành âm thanh.
  • voice_config.yaml: Cấu hình tốc độ đọc (0.85x - 0.9x), tông giọng ấm áp, tự nhiên, ngắt nghỉ hợp lý.