Chuyển giọng nói thành văn bản

Whisper (OpenAI)

Dịch âm thanh hoặc video thành văn bản với tính năng dịch ngôn ngữ

Lượt xem 1,7B
Lượt truy cập hàng tháng 1,7B
Xếp hạng toàn cầu ##26
Lượt bình chọn 0

Giới thiệu về công cụ này

Whisper là hệ thống nhận dạng giọng nói tự động mã nguồn mở, được huấn luyện trên 680.000 giờ dữ liệu được giám sát đa ngôn ngữ và đa nhiệm thu thập từ web. Hệ thống được thiết kế để xử lý tốt các giọng địa phương, tiếng ồn nền và ngôn ngữ kỹ thuật, đồng thời có thể chép lời và dịch giọng nói từ nhiều ngôn ngữ sang tiếng Anh. Đây là một phương pháp đầu-cuối đơn giản, được triển khai dưới dạng Transformer mã hóa-giải mã. Whisper cũng có khả năng nhận dạng ngôn ngữ và tạo dấu thời gian ở cấp độ cụm từ. Hệ thống được thiết kế để dễ sử dụng và có độ chính xác cao, cho phép nhà phát triển thêm giao diện giọng nói vào nhiều ứng dụng hơn.

#Speech-To-Text

Phân tích lưu lượng truy cập

Các chỉ số về lưu lượng truy cập, thứ hạng và mức độ tương tác của công cụ này.

Xếp hạng toàn cầu ##26
Xếp hạng theo quốc gia #82
Lượt truy cập hàng tháng 1,7B

Xu hướng lượt truy cập

Không có dữ liệu xu hướng

Mức độ tương tác

  • Tỷ lệ thoát--
  • Số trang mỗi lượt truy cập--
  • Thời lượng trung bình--

Nguồn lưu lượng truy cập

Không có dữ liệu nguồn

Các quốc gia hàng đầu

Không có dữ liệu quốc gia

Bản xem trước giao diện

Đánh giá của người dùng