DataThink
Kinh nghiệm
Giọng nói·Sự kiện, hội nghị

Real-time Simultaneous Interpretation System

Nghe diễn giả nói tiếng Anh và phát ra tiếng Việt qua loa hội trường với độ trễ dưới hai giây. Bộ đệm gom đủ ngữ cảnh trước khi dịch, tên riêng và thuật ngữ được khoá lại để không bị dịch sai.

< 2sđộ trễ đầu cuối
12h15đã dịch thực tế
7phiên trong 2 ngày

Bối cảnh và vấn đề

Lãnh đạo nước ngoài sang trình bày cho lực lượng lao động phần lớn nói tiếng Việt. Thuê phiên dịch cabin thì tốn kém, phải đặt trước, cần thiết bị riêng và không thể phủ hết mọi phiên trong một sự kiện nhiều ngày. Bỏ phiên dịch thì phần lớn khán phòng ngồi nghe mà không hiểu.

Giải pháp

Hệ thống nghe liên tục, nhưng không dịch từng từ. Điểm mấu chốt là bộ đệm gom khoảng ba mươi từ trước khi gửi đi dịch: dịch từng từ thì câu ra rời rạc vô nghĩa, còn chờ hết câu thì độ trễ không chấp nhận được. Ba mươi từ là điểm cân bằng tìm ra qua thử nghiệm thực tế. Danh sách tên riêng, tên thương hiệu và thuật ngữ chuyên ngành được khoá cứng để giữ nguyên bản tiếng Anh, vì đọc sai tên lãnh đạo trên sân khấu là lỗi không sửa được. Phần điều khiển cũng được siết để hệ thống chỉ dịch, không bao giờ tự hỏi lại hay bình luận.

Kiến trúc kỹ thuật

  1. Micro diễn giả
  2. Nhận dạng tiếng Anh
  3. Bộ đệm 30 từ
  4. Dịch và tổng hợp giọng
  5. Loa hội trường

Kết quả

  • Độ trễ đầu cuối dưới hai giây, đủ để khán phòng theo kịp diễn giả
  • Đã phục vụ thực tế 12 giờ 15 phút phiên dịch liên tục qua bảy phiên trong hai ngày
  • Danh sách tên riêng và thuật ngữ được giữ nguyên, không bị dịch sai
  • Hai cấu hình cho hai nhu cầu: ưu tiên độ chính xác hoặc ưu tiên tốc độ phản hồi
  • Toàn bộ nội dung được lưu lại thành bản ghi song ngữ và tài liệu tóm tắt sau sự kiện

Giao diện minh hoạ

PHIÊN DỊCH TRỰC TIẾP1.4s

EN · Source

Our priority this quarter is reducing changeover time on the assembly line.

We will review the results at the end of…

VI · Đầu ra

Ưu tiên của quý này là giảm thời gian chuyển đổi trên chuyền lắp ráp.

Chúng ta sẽ xem lại kết quả vào cuối…

bộ đệm 30 từ4 thuật ngữ được khoá

Dựng lại bằng dữ liệu mẫu. Không phải ảnh chụp hệ thống thật.

Công nghệ sử dụng

Realtime SpeechAzure SpeechWebSocketasyncioNeural TTS

Bắt đầu bằng một buổi khảo sát, không mất phí.

Kể cho chúng tôi công đoạn đang tốn người nhất. Trong vòng một tuần bạn sẽ nhận được đánh giá thẳng thắn: nên làm, chưa nên làm, hay có cách rẻ hơn mà không cần tới AI.

hello@datathinkai.com · [số điện thoại]

Chúng tôi phản hồi trong 24 giờ làm việc.