2~3분짜리 영상 넣는것만으로는 생각보다 잘 안나옴데이터셋이 많으면 잘나올것 같긴한데생각보다 구하기 힘들더라bgm다 자르고 하려면 직접 수작업으로 영상편집 노가다 해야하는데귀찮다..
배경음악 이랑 목소리 분리해주는 프로그램으로 분리해주고 목소리 만 따로때서 침묵 구간 다 없애고 하나의 파일로 취합해서 파일넘겨야함
생각보다 빡세더라....
배경음 좀 있어도 적당히 나오긴 하던데, 나는 목소리에 감정표현을 넣을 수가 없는 부분이 가장 아쉬웠음 웃음소리나 놀라움 같은 억양을 표현 못하니까 뭘 넣어도 밋밋하드라
ㅇㅇ 역시 아직 시기상조가 맞는듯 7천원 걍 날렸넹
그냥 tts나 음성쪽은 gpt5를 기다려야할것같음. 이번 발표만 봐도 gpt는 멀티모달이다 보니 문맥에 맞는 억양이나 감정표현을 할수 있는것같음 결국 ai는 gpt 미만잡임..
gpt 음성모델은 분명 시연영상에서 감정표현을 깔끔하게 해냈으니까 기대해봐야지 일레븐렙스로 나도 나름 재밌게 놀았음. 목소리 특이하다고 생각하는 사람들 다 만들어보긴 했으니 ㅋㅋ 조금 아쉬운 부분이 있을 뿐이지