원래 ai커버 어떤 원리인지 모를때는 와 진짜 곧 자비스급 인공지능 가능하겠는데? 이 생각 났는데
어떤사람이 ai 커버 원리 쉽게 설명해준거 봤는데
목소리 파형을 그림으로 표현->그림AI한테 학습->이미 있는 목소리 파형을 아카네처럼 그려달라고 요청
이렇게 원리를 알고나니까 걍 아...생각보다 쉬운거였네 하고 특들갑 멈춤
원래 ai커버 어떤 원리인지 모를때는 와 진짜 곧 자비스급 인공지능 가능하겠는데? 이 생각 났는데
어떤사람이 ai 커버 원리 쉽게 설명해준거 봤는데
목소리 파형을 그림으로 표현->그림AI한테 학습->이미 있는 목소리 파형을 아카네처럼 그려달라고 요청
이렇게 원리를 알고나니까 걍 아...생각보다 쉬운거였네 하고 특들갑 멈춤
ㅇㅇ ai노래 자체 원리는 그림ai랑 똑같음 디퓨전모델 응용한거. ai라고하기도 솔직히 민망한
아 파형을 그려주는거였구나
손꾸락이랑 글자 못 쓰는 거처럼 그래서 보이스쪽도 인간이 감지할 수 있는 뭔가 미묘한 이질감 있음 달리4가 나오고 그 아키텍처 기반으로 만들거나 제미니 밑바닥부터 멀티모달 이런 거에 힌트 받아서 만들면 가능할 거 같은데
그래서 창법은 원곡 창법 따라가잖슴 한계가 너무 명확해
이게 쉬워? ㅋㅋ 기술발전과 발상의전환이 합쳐진 엄청난 기술이야 이거