지금 gpt에 들어가 있는 목소리는 뭐임? 억양이나 대화할 때 분위기에 따라서 진짜 사람이 말하는 거 처럼 다이나믹한 목소리톤은 아직 불가능한가? 목소리 하나라도 화난 목소리, 달콤한 목소리, 평소 목소리, 웃긴 목소리, 슬픈 목소리, 우는 목소리 다양할텐데... 로봇 본격적으로 나오면 이런거도 중요할 거 같은데 목소리쪽은 아직 어떻게 되는지 몰라서 궁금함.
그쪽으로도 많이 연구하고 있던걸로 기억함
노래도 되고 연기도 됨 유튜브에 많으니 찾아봐
올인원은 아니지만 각각 유저들이 활용 가능한 조각들로 퍼져있음
노무현 ai 진지하게 진짜랑 가짜 구분 못함 지금
이미 다 됌 ai 성우 있음
그림이랑 거의 마찬가지라 보면 됨. 아직 더 발전해야 하는데 어쨌든 정복 가능한 영역으로 보임
SSML적용한 TTS 보고오셈 - dc App
걍 챗지피티가 지원을 안해주는것뿐임.
지원하면 악용될 가능성이 떡상하니까
쓸 이유가 없어서 안 쓰는거라고 생각함. 더 좋은 모델도 널렸을 걸. 근데 GPT가 굳이 연산량 더 많이 들고, 비용 많이 나가면서 목소리 업글 할 필요는 없을 듯. 싸지면 하겠지.
이건 메타가 잘 하고 있던데
너 목소리도 1시간 샘플만 있으면 맘대로 구현함
이미 있음 개인 로컬로도 자기목소리 학습해서 ai에 써먹을 수 있음