Suno ra mắt tính năng 'Speech', kết hợp giọng đọc cùng nhạc nền
Startup âm nhạc AI Suno vừa phát hành tính năng mới mang tên Speech, cho phép người dùng tạo giọng đọc lồng ghép nhạc nền đồng bộ trong một file âm thanh duy nhất.

Nền tảng tạo nhạc bằng AI Suno đang mở rộng phạm vi hoạt động ra ngoài mảng sáng tác ca khúc thuần túy với việc tung ra tính năng mới mang tên "Speech". Công cụ này có khả năng tạo ra bản ghi âm giọng đọc kèm nhạc nền phù hợp, sau đó xuất ra dưới dạng một bản audio tích hợp hoàn chỉnh.
Tạo giọng đọc và nhạc nền cùng lúc
Để sử dụng tính năng này, người dùng chỉ cần nhập văn bản hoặc ý tưởng, đồng thời mô tả chất giọng cũng như phong cách âm nhạc mong muốn. Mô hình sau đó sẽ tự động tạo ra cả giọng lồng tiếng lẫn phần nhạc nền bổ trợ tương ứng.
Theo Jack Brody, Giám đốc sản phẩm của Suno, công ty đã thử nghiệm Speech với một nhóm người dùng nhỏ trong vòng một tháng trước khi phát hành rộng rãi. Suno gợi ý người dùng có thể tận dụng tính năng này để tạo các nội dung như đọc thơ, bài thiền định có hướng dẫn và truyện kể trước giờ đi ngủ.
Do tính năng vẫn đang trong giai đoạn beta, Suno lưu ý rằng hệ thống thỉnh thoảng vẫn gặp lỗi, bao gồm cả việc giọng đọc thiếu nhất quán khi ngữ điệu Anh - Anh đôi lúc bị lẫn sang giọng Anh - Úc.
Dấu hỏi về dữ liệu huấn luyện và áp lực pháp lý bủa vây
Suno hiện vẫn chưa công bố chi tiết về cách thức huấn luyện mô hình nền tảng đứng sau tính năng Speech.
Bản cập nhật này xuất hiện trong bối cảnh các nền tảng âm nhạc tạo sinh (generative music) đang phải đối mặt với sự giám sát ngày càng gắt gao liên quan đến nguồn dữ liệu đào tạo. Các hãng thu âm lớn đã đệ đơn kiện Suno vì cáo buộc vi phạm bản quyền. Ngoài ra, một tòa án tại Munich gần đây cũng đã ra phán quyết bất lợi cho startup này, bác bỏ lập luận "sử dụng hợp lý" (fair use) như một căn cứ pháp lý để dùng các tài liệu được bảo hộ bản quyền.

