AI 음악 생성 플랫폼 수노(Suno)가 새로운 음악 생성 모델 v6를 공개했다. 이번 업데이트는 음질과 음악적 표현력 향상에 더해 기존 곡의 특정 부분을 자연어로 수정하고, 여러 음원을 결합하거나 텍스트·이미지·영상·오디오를 음악 제작의 출발점으로 활용할 수 있도록 창작 기능을 확장한 것이 특징이다.

수노, 차세대 음악 생성 모델 ‘v6’ 공개 : AI이미지제작
수노가 9일(현지시간) 차세대 음악 생성 모델 v6 제품군을 선보였다. 수노는 이번 모델을 워너뮤직그룹(WMG), BMG, Believe 등 음악산업 파트너와 함께 개발했다고 밝혔다.
v6 제품군은 v6, v6-wild, v6-mini 등 3가지 모델로 구성된다.
기본 모델인 v6는 수노가 제시한 요구를 비교적 정확하게 구현하는 데 초점을 맞췄다. 수노는 다양한 장르와 스타일에서 안정적이고 정교한 음악을 생성하면서 보컬, 악기 구성, 곡 구조, 분위기와 같은 음악적 요소에 대한 이해도를 높였다고 설명했다.
v6-wild는 반대로 예측하기 어려운 결과를 만드는 실험형 모델이다. 기존 프롬프트에서 벗어난 음악적 선택과 장르 결합 등을 시도해 새로운 아이디어를 얻는 데 초점을 맞췄다. v6-mini는 보다 가볍고 빠른 모델로, 모든 요금제 이용자가 사용할 수 있다.
세 모델 모두 한 번에 최대 8분 길이의 음악을 생성할 수 있다. 다만 v6와 v6-wild는 Pro·Premier 구독자에게 제공되며, v6-mini는 모든 요금제에서 이용할 수 있다.
기존 음악을 자연어로 수정
이번 업데이트에서 눈에 띄는 부분은 음악을 처음부터 다시 생성하지 않고 기존 곡의 특정 부분만 수정할 수 있다는 점이다.
예를 들어 코러스 부분을 다른 보컬 구성으로 바꾸거나 특정 구간의 분위기를 변경하는 식으로 자연어 명령을 내릴 수 있다. 가사 역시 곡 전체를 다시 만들지 않고 특정 단어나 한 줄만 수정할 수 있도록 했다.
여러 곡의 요소를 결합하는 기능도 추가됐다. 사용자는 서로 다른 음악에서 보컬과 드럼 등 원하는 요소를 가져와 하나의 곡으로 구성하는 매시업 작업을 자연어 지시와 함께 진행할 수 있다. 특정 구간의 소리를 샘플로 활용해 새로운 비트를 만드는 작업도 하나의 제작 흐름에서 지원한다.
텍스트 넘어 이미지·영상·오디오까지 입력
창작 방식도 확대됐다. 기존에는 주로 텍스트 프롬프트를 통해 음악을 만들었다면, v6에서는 텍스트와 오디오, 이미지, 영상을 음악 생성의 입력으로 활용할 수 있다. 음성 메모나 영상, 이미지와 글을 조합해 새로운 음악을 만드는 방식이다.
수노는 이와 함께 기존의 Custom Models, Suno Sounds, Remix & Edit 등 창작·편집 기능에도 v6를 적용한다고 밝혔다. 사용자가 자신의 음악을 기반으로 맞춤형 모델을 만들거나 샘플과 효과음을 생성하고, 기존 음악을 확장·편집하는 작업에도 새 모델을 활용할 수 있다.
음악산업과의 협력도 주요 변화
이번 v6 출시는 단순한 모델 업데이트를 넘어 수노와 음악산업의 관계가 달라지고 있다는 점에서도 주목된다.
수노는 워너뮤직그룹, BMG, Believe 등 음악산업 파트너와 협력해 v6 세대를 개발했다고 밝혔다. 외신에 따르면 이번 협력에는 라이선스 음악을 활용한 모델 개발과 권리자에 대한 수익 배분 논의도 포함됐다.
수노는 앞으로 아티스트가 직접 참여 여부를 선택하고, 참여에 따른 수익을 받을 수 있는 옵트인 방식의 제품과 서비스도 개발할 계획이라고 밝혔다. 이는 AI가 기존 음악을 학습해 콘텐츠를 만들어내는 데 그치지 않고, 아티스트와 AI 서비스가 수익을 공유하는 구조로 확장하려는 움직임으로 볼 수 있다.
수노는 v6 세대가 순차적으로 적용되면서 기존 모델을 종료하고 플랫폼을 v6 세대로 전환할 계획이다. 이에 따라 이번 업데이트는 단순히 새로운 음악 생성 모델 하나를 추가한 것보다 음악 생성부터 편집·샘플링·멀티모달 입력까지 창작 과정 전반을 v6 중심으로 재편하는 업데이트라는 의미가 있다.
한눈에 보는 수노 v6 업데이트
| 구분 | 주요 내용 |
|---|---|
| v6 | 정교하고 안정적인 음악 생성에 초점 |
| v6-wild | 예측하기 어려운 음악적 실험과 장르 결합 |
| v6-mini | 빠르고 가벼운 생성 모델, 전체 이용자 대상 |
| 생성 길이 | 최대 8분 |
| 부분 편집 | 자연어로 곡의 특정 부분 수정 |
| 가사 편집 | 특정 단어·문장만 수정 |
| 매시업 | 여러 곡의 요소를 하나의 작업에서 결합 |
| 샘플링 | 특정 구간을 활용해 새로운 음악 제작 |
| 멀티모달 | 텍스트·오디오·이미지·영상 입력 지원 |
| 기타 기능 | Custom Models, Sounds, Remix & Edit 등에 v6 적용 |
이번 v6의 핵심은 음악을 ‘한 번 생성하고 끝내는 방식’에서 ‘생성한 음악을 대화하듯 계속 수정하고 조합하는 방식’으로 확장했다는 데 있다. 특히 자연어 기반 부분 편집과 멀티모달 입력이 실제 음악 제작 과정에서 어느 정도의 정밀도를 보여줄지가 향후 이용자들의 주요 관심사가 될 것으로 보인다.
[이 기사의 저작권은 이비즈타임즈에 있습니다]




