가사와 스타일 설명을 넣으면 서버의 그래픽카드가 YuE2라는 오픈 음악 모델을 돌려 보컬과 반주가 함께 들어간 곡을 만들어 냅니다. 곡 하나가 만들어지기까지는 곡 길이의 절반에서 한 배쯤 걸리고, 그동안 화면의 진행 상황 카드가 대기 → 생성 중 → 완료로 바뀝니다. 끝난 곡은 아래 만들어진 음악 목록에 최신순으로 쌓이고 누구나 재생·다운로드할 수 있습니다.
가사는 [Verse] [Chorus] [Bridge] [Outro] 같은 섹션 태그를 줄 앞에 써서 구조를 알려 주는 편이 좋습니다. 태그가 없으면 모델이 곡 구조를 스스로 정하는데, 후렴이 어디인지 헷갈려 밋밋해질 때가 많아요. 스타일 칸에는 장르, 보컬 성별, 분위기, 악기, 템포, 언어를 쉼표로 나열합니다. 모델이 영어 설명에 익숙하니 스타일은 영어로 적기를 권합니다.
생성은 관리자 로그인이 필요하고 듣기는 열려 있습니다. 그래픽카드가 한 대라 대기열은 동시에 3곡까지만 받고, 앞에 곡이 있으면 순서대로 처리됩니다.
Am-a-p(Multimodal Art Projection) 팀이 공개한 오픈 음악 생성 모델입니다. 가사와 스타일 설명을 받아 사람 목소리로 부르는 보컬과 반주를 한 번에 만들어 냅니다. 배경음악만 뽑는 모델과 달리 가사가 실제로 노래로 불린다는 점이 특징입니다.
A저희 그래픽카드 기준으로 곡 길이의 절반에서 한 배 정도입니다. 60초 곡이면 대략 30초에서 1분쯤 기다리면 되고, 앞에 대기 중인 곡이 있으면 그만큼 더 걸립니다. 진행 상황 카드의 "앞에 N곡" 표시로 순서를 알 수 있습니다.
A됩니다만 비공식 지원입니다. 모델이 공식적으로 다루는 언어는 영어·중국어·일본어이고, 한국어는 학습 데이터가 적어 발음이 어색하거나 일부 음절을 흘려 부를 수 있습니다. 스타일에 "Korean"을 넣고, 한 줄을 너무 길게 쓰지 않으면 결과가 나아집니다.
A필수는 아니지만 강력히 권장합니다. 줄 앞에 [Verse], [Chorus], [Bridge], [Outro] 를 적으면 모델이 절과 후렴을 구분해 멜로디에 변화를 줍니다. 태그 없이 넣으면 곡이 한 덩어리처럼 평평하게 나오기 쉽습니다. 태그 자체는 노래로 불리지 않습니다.
A생성은 관리자만 할 수 있습니다. 그래픽카드 한 대가 순서대로 처리하는 구조라 누구에게나 열어 두면 대기열이 금세 막히기 때문입니다. 대신 만들어진 곡을 듣고 내려받는 것은 로그인 없이 누구나 가능합니다.
AYuE2는 CC BY-NC 라이선스에 창작자 예외 조항이 붙어 있습니다. 개인 채널이나 영상의 배경음악처럼 자기 콘텐츠에 쓰는 것은 괜찮지만, 곡 자체를 음원으로 팔거나 상업 서비스에 다시 파는 것은 안 됩니다. 정확한 범위는 모델 저장소의 라이선스 문서를 확인해 주세요.
A이 서버의 music/files 폴더에 MP3로 남습니다. 외부 서비스로 나가지 않고, 목록에서 삭제하지 않는 한 그대로 보관됩니다. 저장공간 정리 때 오래된 파일부터 지워질 수 있으니 오래 쓸 곡은 내려받아 두세요.