Chuyển đổi CVSD sang SPH

Chuyển âm thanh CVSD sang SPH — không cần cài phần mềm

Thả tập tin ở đây. 1 GB Kích thước file tối đa hoặc là Đăng ký
đến
Facebook Amazon Microsoft Tesla Nestle Walmart L'Oreal

Engine đám mây nhanh

Chuyển đổi chạy trên máy chủ — bản ghi CVSD lớn chuyển sang SPH mà không làm chậm máy.

Chuyển đổi nhanh

Hầu hết hoàn tất trong vài giây.

Phạm vi rộng hơn

CVSD là định dạng ngách. Chuyển sang SPH đưa âm thanh vào định dạng bộ công cụ HTK nhận diện.

Làm thế nào để chuyển đổi CVSD sang SPH

1

Lựa chọn các tập tin từ Máy tính, Google Drive, Dropbox, URL hoặc bằng cách kéo tập tin vào trang này.

2

Chọn sph hoặc bất kỳ định dạng nào khác bạn cần chuyển đổi sang (hỗ trợ hơn 200 định dạng)

3

Hãy để tập tin chuyển đổi và bạn có thể tải tập tin sph của bạn xuống ngay sau đó

Về các định dạng

CVSD (Continuously Variable Slope Delta modulation) là phương pháp số hóa giọng nói được chuẩn hóa cho sử dụng quân sự và viễn thông bởi NATO và CCITT trong những năm 1970. Nó mã hóa sự khác biệt giữa các mẫu liên tiếp thành một bit duy nhất — 1 nếu mẫu hiện tại vượt quá dự đoán, 0 nếu ngược lại — trong khi bộ lọc nén âm tiết điều chỉnh kích thước bước bằng cách theo dõi chuỗi các bit giống nhau. Hoạt động ở 16 đến 64 kbps, CVSD cân bằng giữa độ rõ giọng nói và băng thông, trở thành lựa chọn mã hóa cho các liên kết quân sự bảo mật và hệ thống vô tuyến chiến thuật. Luồng bit có thể được giải mã bằng phần cứng đơn giản, ban đầu được tích hợp trong các mạch tích hợp chuyên dụng. Một ưu điểm là sự đơn giản khi triển khai — bộ mã hóa và giải mã chỉ cần tài nguyên tối thiểu, cho phép xử lý thời gian thực trên phần cứng nhúng công suất thấp. Khả năng chống chịu trong điều kiện nhiễu là thế mạnh khác, vì lỗi bit đơn lẻ chỉ ảnh hưởng đến các mẫu cục bộ thay vì làm hỏng toàn bộ khung. SoX cung cấp hỗ trợ mã hóa và giải mã bằng phần mềm, cho phép các hệ thống hiện đại làm việc với các bản ghi CVSD cũ từ kho lưu trữ quân sự và hạ tầng viễn thông cổ điển.
Nhà phát triển: CCITT / NATO
Phát hành lần đầu: 1970
SPH là phần mở rộng tệp cho âm thanh lưu trữ trong định dạng NIST SPHERE (SPeech HEader REsources), một tiêu chuẩn do Viện Tiêu chuẩn và Công nghệ Quốc gia Hoa Kỳ tạo ra khoảng năm 1990. Được xây dựng cho nghiên cứu giọng nói, tệp SPH mang header ASCII 1024 byte chứa đầy siêu dữ liệu — mã định danh cơ sở dữ liệu, số kênh, tần số lấy mẫu, thứ tự byte và kiểu nén — giúp mỗi bản ghi tự mô tả. Âm thanh bên dưới thường là PCM tuyến tính 16-bit lấy mẫu ở 16 kHz, dù các cấu hình khác cũng được phép. Các nhà nghiên cứu tại NIST, DARPA và các trường đại học trên toàn thế giới dựa vào SPH để phân phối kho ngữ liệu giọng nói như TIMIT, Switchboard và các bộ sưu tập LDC — nền tảng của các hệ thống nhận dạng giọng nói tự động hiện đại. Ưu điểm chính là header đọc được bằng mắt người cho phép các script phân tích siêu dữ liệu bản ghi mà không cần giải mã nhị phân. Sự chuẩn hóa nghiêm ngặt của định dạng cũng loại bỏ sự mơ hồ khi chia sẻ tập dữ liệu giữa các tổ chức và nền tảng. Vì tệp SPH lưu trữ PCM không nén, chúng bảo toàn toàn bộ chất lượng âm thanh — điều cực kỳ quan trọng khi huấn luyện mô hình âm học mà ngay cả những artifact nhỏ cũng có thể làm lệch kết quả.
Phát hành lần đầu: 1990

Các câu hỏi thường gặp

Tại sao chuyển CVSD sang SPH?

CVSD bị giới hạn ở chất lượng điện thoại. Chuyển sang SPH mang lại tiêu chuẩn cho ngữ liệu nghiên cứu giọng nói.

Làm sao mở SPH?

Bộ công cụ HTK, SoX và công cụ nghiên cứu giọng nói.

Có ảnh hưởng chất lượng không?

SPH bảo tồn trung thực. Đầu ra khớp chất lượng CVSD gốc.

Có trên mọi thiết bị không?

Có.

Có thể chuyển nhiều bản ghi không?

Có.

Có tốn phí không?

Chuyển đổi tiêu chuẩn không tốn phí.