Suno ra mắt mô hình AI tạo nhạc v6 với sự hỗ trợ từ ngành công nghiệp thu âm
Suno vừa phát hành mô hình AI tạo nhạc v6, là phiên bản đầu tiên được huấn luyện với dữ liệu có bản quyền từ các đối tác lớn như Warner Music Group, BMG và Believe. Bản cập nhật này mang đến ba biến thể mô hình mới, khả năng hiểu thể loại âm nhạc tốt hơn và tính năng chỉnh sửa trực tiếp qua khung chat.

Mô hình âm nhạc AI v6 mới của Suno là sản phẩm đầu tiên được thực hiện với sự hỗ trợ từ ngành công nghiệp thu âm. Jack Brody của Suno chia sẻ với tờ The Verge rằng v6 được "huấn luyện từ đầu, với tập dữ liệu mới không bao gồm dữ liệu giống như các mô hình trước đây của chúng tôi." Dữ liệu này bao gồm nội dung được cấp phép từ các đối tác Warner Music Group, BMG và Believe, cũng như "dữ liệu người dùng." Vẫn chưa rõ liệu dữ liệu huấn luyện của v6 có hoàn toàn không chứa nội dung bị nghi ngờ về nguồn gốc bản quyền hay không.
Một trong những thay đổi lớn ở v6 là thực tế có ba mô hình khác nhau: v6, v6-wild và v6-mini. Mini là mô hình cung cấp miễn phí cho tất cả mọi người, tập trung vào việc tạo ra nhanh chóng và ít tốn tài nguyên. Kết quả mà nó tạo ra đơn giản hơn và thường có nhiều hiện tượng nhiễu (artifact) làm lộ rõ đây là sản phẩm của AI. v6-wild được cho là khó đoán hơn. Brody cho biết v6-wild được thiết kế cho "những sự cố vui vẻ và những điểm không hoàn hảo tự nhiên." Mặc dù vậy, qua các thử nghiệm hạn chế của mình, tôi thấy khó có sự khác biệt giữa bản wild và bản v6 tiêu chuẩn.
Cả ba mô hình đều cải thiện đáng kể khả năng nhận iện thể loại. Tôi đã tái sử dụng một số câu lệnh (prompt) từng dùng cho các mô hình cũ yêu cầu bài hát thể loại "hyperpop" hoặc "krautrock" nhưng khi đó đã bị lệch mục tiêu hoàn toàn. Ngược lại, v6 đã nắm bắt chính xác tất cả các đặc điểm bề ngoài của bất kỳ thể loại nào tôi đưa ra.
Tuy nhiên, điều mà nó vẫn không thể làm được là thực sự tạo ra "những điểm không hoàn hảo tự nhiên." Giống như v5, các nỗ lực của tôi nhằm nhận lại kết quả lệch nhịp, lạc giọng hoặc hơi chói tai đều thất bại mỗi lần. Dù bạn có đẩy v6 của Suno đến đâu đi nữa, nó vẫn không thể tạo ra thứ gì khác ngoài sự hoàn hảo về giai điệu và tiết tấu. Bảo nó rằng bạn muốn "giọng hát đơn âm" và "không có trống", nó sẽ phớt lờ bạn hoàn toàn. Những yêu cầu lặp đi lặp lại về một "tiếng piano lạc nhịp được chơi ngẫu hứng, không màng đến tông hay tiết tấu" và "lạc nhịp hoàn toàn với phần còn lại của bài hát" không hề mang lại kết quả nào như vậy.
Nó vẫn giữ lại những điểm không hoàn hảo không tự nhiên của âm nhạc AI, với phần giọng hát đặc biệt có vẻ tạo ra nhiều hiện tượng nhiễu sắc bén vốn phổ biến ở các mô hình AI hơn so với v5.
Suno v6 cũng có một số cập nhật bên trong có thể thay đổi cơ bản cách mọi người tương tác với nó. Giờ đây, người dùng có thể chỉnh sửa các phần của bài hát bằng ngôn ngữ thông thường trong khung chat, và việc thay đổi các yếu tố riêng lẻ như tiếng guitar hoặc một câu lời bài hát duy nhất sẽ không đòi hỏi phải tạo lại toàn bộ bản nhạc. v6 cũng có thể trộn lẫn nhiều yếu tố từ thư viện Suno của bạn, kết hợp các đầu ra thành những sáng tạo mới.
Các câu lệnh cũng không còn bị giới hạn trong mô tả văn bản. Suno v6 có thể tạo các bản nhạc dựa trên hình ảnh, video hoặc các tệp âm thanh khác.
Suno v6 bắt đầu được triển khai từ hôm nay và công ty cho biết cuối cùng họ sẽ cho nghỉ hưu các mô hình trước đó của mình.
🌐 SUNO RA MẮT MÔ HÌNH AI TẠO NHẠC V6 VỚI SỰ HỖ TRỢ TỪ NGÀNH CÔNG NGHIỆP THU ÂM Mô hình âm nhạc AI v6 mới của Suno là sản phẩm đầu tiên được thực hiện với sự hỗ trợ từ ngành công nghiệp thu âm. Jack Brody của Suno chia sẻ với tờ The Verge rằng v6 được "huấn luyện từ đầu, với tập dữ liệu mới không bao gồm dữ liệu giống như các mô hình trước đây của chúng tôi." Dữ liệu này bao gồm nội dung được cấp phép từ các đối tác Warner Music Group, BMG và Believe, cũng như "dữ liệu người dùng." Vẫn chưa rõ liệu dữ liệu huấn luyện của v6 có hoàn toàn không chứa nội dung bị nghi ngờ về nguồn gốc bản quyền hay không. Một trong những thay đổi lớn ở v6 là thực tế có ba mô hình khác nhau: v6, v6-wild và v6-mini. Mini là mô hình cung cấp miễn phí cho tất cả mọi người, tập trung vào việc tạo ra nhanh chóng và ít tốn tài nguyên. Kết quả mà nó tạo ra đơn giản hơn và thường có nhiều hiện tượng nhiễu (artifact) làm lộ rõ đây là sản phẩm của AI. v6-wild được cho là khó đoán hơn. Brody cho biết v6-wild được thiết kế cho "những sự cố vui vẻ và những điểm không hoàn hảo tự nhiên." Mặc dù vậy, qua các thử nghiệm hạn chế của mình, tôi thấy khó có sự khác biệt giữa bản wild và bản v6 tiêu chuẩn. Cả ba mô hình đều cải thiện đáng kể khả năng nhận iện thể loại. Tôi đã tái sử dụng một số câu lệnh (prompt) từng dùng cho các mô hình cũ yêu cầu bài hát thể loại "hyperpop" hoặc "krautrock" nhưng khi đó đã bị lệch mục tiêu hoàn toàn. Ngược lại, v6 đã nắm bắt chính xác tất cả các đặc điểm bề ngoài của bất kỳ thể loại nào tôi đưa ra. Tuy nhiên, điều mà nó vẫn không thể làm được là thực sự tạo ra "những điểm không hoàn hảo tự nhiên." Giống như v5, các nỗ lực của tôi nhằm nhận lại kết quả lệch nhịp, lạc giọng hoặc hơi chói tai đều thất bại mỗi lần. Dù bạn có đẩy v6 của Suno đến đâu đi nữa, nó vẫn không thể tạo ra thứ gì khác ngoài sự hoàn hảo về giai điệu và tiết tấu. Bảo nó rằng bạn muốn "giọng hát đơn âm" và "không có trống", nó sẽ phớt lờ bạn hoàn toàn. Những yêu cầu lặp đi lặp lại về một "tiếng piano lạc nhịp được chơi ngẫu hứng, không màng đến tông hay tiết tấu" và "lạc nhịp hoàn toàn với phần còn lại của bài hát" không hề mang lại kết quả nào như vậy. Nó vẫn giữ lại những điểm không hoàn hảo không tự nhiên của âm nhạc AI, với phần giọng hát đặc biệt có vẻ tạo ra nhiều hiện tượng nhiễu sắc bén vốn phổ biến ở các mô hình AI hơn so với v5. Suno v6 cũng có một số cập nhật bên trong có thể thay đổi cơ bản cách mọi người tương tác với nó. Giờ đây, người dùng có thể chỉnh sửa các phần của bài hát bằng ngôn ngữ thông thường trong khung chat, và việc thay đổi các yếu tố riêng lẻ như tiếng guitar hoặc một câu lời bài hát duy nhất sẽ không đòi hỏi phải tạo lại toàn bộ bản nhạc. v6 cũng có thể trộn lẫn nhiều yếu tố từ thư viện Suno của bạn, kết hợp các đầu ra thành những sáng tạo mới. Các câu lệnh cũng không còn bị giới hạn trong mô tả văn bản. Suno v6 có thể tạo các bản nhạc dựa trên hình ảnh, video hoặc các tệp âm thanh khác. Suno v6 bắt đầu được triển khai từ hôm nay và công ty cho biết cuối cùng họ sẽ cho nghỉ hưu các mô hình trước đó của mình. 🗞 Nguồn: The Verge #vgsnews #vgs #tintuc
Nguồn: The Verge