Nhạc AI của Nghe Mãi làm ra thế nào: sáng tác, chấm lời, loại bài lỗi
Mỗi bài trên Nghe Mãi đi qua máy sáng tác, rồi một vòng nghe lại bằng máy nhận giọng hát để loại bài hát sai lời, dạo đầu quá dài hay im lặng giữa bài.

"Nhạc AI" nghe như bấm một nút là ra bài. Thật ra phần bấm nút là phần dễ nhất. Phần khó là biết bài nào hỏng trước khi khách nghe thấy: máy hát nuốt chữ, dạo đầu kéo dài cả phút, giữa bài im bặt mười mấy giây, hoặc hát hết lời rồi còn lê thê nửa phút nhạc nền. Bài này kể lại quy trình thật mà mỗi bài trên Nghe Mãi phải đi qua.
Bước 1: Lời và "đơn đặt hàng" cho từng bài
Mỗi bài bắt đầu từ một chủ đề cụ thể, gần đời sống Việt: một ly trà gừng ở phố cổ, cây đàn cũ không ai lên dây, buổi sáng mẹ đưa con tới lớp. Kèm theo chủ đề là lời bài hát chia đoạn (phiên khúc, điệp khúc, đoạn chuyển) và một dòng mô tả âm nhạc: thể loại, tâm trạng, nhạc cụ chính, nhịp, giọng nam hay nữ.
Những bài thuộc cùng một album được viết theo một mạch, để album nghe liền nhau chứ không phải gom ngẫu nhiên.
Bước 2: Máy sáng tác và hát
Phần âm nhạc do một mô hình sáng tác nhạc chạy trên máy chủ riêng của Nghe Mãi đảm nhận: dựng giai điệu, hoà âm, phối nhạc cụ và hát lời tiếng Việt. Lời bài hát không gửi sang dịch vụ tạo nhạc bên ngoài.
Mỗi lần sáng tác cho ra một phiên bản khác nhau, nên cùng một lời có thể ra nhiều bản. Đây là điểm quan trọng cho bước sau.
Bước 3: Nghe lại bằng máy và chấm điểm
Sau khi có bản nhạc, một máy khác "nghe" lại bài: tách phần giọng hát ra khỏi nhạc nền, rồi dùng mô hình nhận dạng giọng nói để chép lại những gì đã được hát. Bản chép này được so với lời gốc.
Một bài chỉ được giữ khi đạt đủ các ngưỡng:
| Tiêu chí | Ngưỡng |
|---|---|
| Lời hát khớp lời gốc | từ 60% trở lên |
| Dạo đầu trước câu hát đầu tiên | không quá 20 giây |
| Khoảng lặng giữa bài | không quá 16 giây |
| Nhạc kéo dài sau câu hát cuối | không quá 30 giây |
Bài rớt thì máy sáng tác lại bản khác. Sau bốn lượt vẫn chưa đạt, bài được đưa ra một danh sách riêng chờ người nghe lại chứ không tự lên kho.
Ngưỡng 60% nghe có vẻ thấp, nhưng máy nhận dạng giọng hát kém hơn nhiều so với giọng nói: nhạc nền, ngân dài, luyến láy đều làm nó chép sai dù ca sĩ hát đúng. Ngưỡng này được chọn sau khi nghe đối chiếu hàng loạt bài thật.
Bước 4: Video lời bài hát chạy theo từng chữ
Vì bước chấm đã biết từng chữ được hát ở giây thứ mấy, Nghe Mãi dùng chính các mốc đó để làm video lời bài hát: chữ sáng dần đúng lúc được hát, giống karaoke. Trên trang mỗi bài, phần lời cũng chạy theo nhạc tới từng chữ, chạm vào một dòng là nghe từ chỗ đó.
Bước 5: Ảnh bìa và lên kho
Bài đạt chuẩn được vẽ ảnh bìa riêng theo cảnh của bài, rồi lên kho với đủ thông tin: thể loại, tâm trạng, giọng, độ dài, nhịp BPM. Từ đây bài xuất hiện trong trình phát, trong album, và được đăng lên kênh YouTube, trang Facebook của Nghe Mãi.
Vậy nhạc AI có "kém" nhạc người làm không
Câu trả lời thật: tuỳ bài. Máy sáng tác giỏi ở các thể loại có khuôn rõ như ballad, acoustic, lofi, pop nhẹ. Nó kém hơn ở những chỗ cần ngẫu hứng tinh tế hoặc giọng hát có cá tính mạnh. Với mục đích làm nhạc nền cho quán — dễ nghe, không giành sự chú ý, mở cả ngày không mệt — nhạc AI đạt chuẩn là đủ tốt, và có lợi thế lớn: kho lớn, mới liên tục, không lo tác quyền.
Muốn nghe thử, bắt đầu từ nhạc Ballad hoặc Acoustic.



