Chuyển đổi giọng hát là công nghệ AI chỉ thay thế chất lượng giọng nói của nguồn âm thanh do người này hát bằng giọng của người nói hoặc nhân vật khác.
Chuyển đổi giọng hát (SVC) là công nghệ chỉ chuyển đổi chất lượng giọng nói (âm sắc) từ giọng hát đầu vào sang giọng của người nói hoặc giọng nhân vật khác trong khi vẫn giữ nguyên các yếu tố âm nhạc như giai điệu, cao độ, lời bài hát và nhịp điệu. Trong khi tính năng tổng hợp văn bản thành giọng nói (TTS) tạo ra giọng mới từ văn bản, thì SVC độc đáo ở chỗ nó sử dụng hiệu suất hát hiện có và “chỉ thay thế giọng nói mà không thay đổi phong cách hát”. Trong sử dụng thực tế, nhiều sai sót được chỉ ra rộng rãi, chẳng hạn như hơi thở và thói quen rung của nguồn hát vẫn còn ở đầu ra, cũng như xu hướng hiện tượng tanh tách và tiếng ồn xảy ra ở quãng cao và giọng giả thanh. Về mặt chi phí, có rất nhiều loại chi phí, từ trả tiền theo nhu cầu sử dụng cho các dịch vụ dựa trên đám mây đến học tập và suy luận trong môi trường địa phương, và trong lĩnh vực này, người ta thường chọn các công cụ dựa trên ngôn ngữ được hỗ trợ và nhu cầu biểu diễn theo thời gian thực, ưu tiên xử lý quyền (cấp phép cho ca sĩ và bài hát gốc).