https://gall.dcinside.com/m/helldiversseries/679395
한국어 더빙 모드 프로젝트 근황여러므로 더빙모드를 잘 써줘서 고맙다최근에 고민이 있었음 더빙모드를 유지보수 할 사람이 나밖에 없는데 신규더빙 제작하기에는 시간이 없음하지만 제작에 공수가 존나 들어서 좀 빡셈제작 과정은 이럼원본음성 스크립트 분석 -gall.dcinside.com이 글 부터 이어짐
다른 헬붕이의 아이디어 덕에 머리속으로 구상만 하던 완전 자동화를 대부분 실체화 할 수 있게 됐음
내가 원하던 자동화 시스템은 원본 음성을 공식 자막에 맞게 성별까지 분류하고 지정해둔 ai보이스로 자동으로 녹음해서 마무리 작업
까지 구현하는게 목표였는데 구현에는 성공함
구현은 성공했는데 퀄리티 문제 때문에 어쩔수 없이 완전 자동화는 포기했지만 거의 대부분 자동화 시킴
먼저 위 이미지처럼 게임내 공식 자막파일을 성공적으로 추출해서 영어와 한국어를 통합화 하는 과정을 거치고 라이브러리로 만듬
음성을 ai가 듣고 영문 스크립트로 변환할때 여기 공식 자막에 있는 영문을 찾으면 바로 한글 공식 자막으로 변환되게 제작했음
그리고 위 이미지처럼 기존에 작업할때 cpu로 작업하는걸로 만들었음 10초에 대사 하나 정도로 그래도 빠르다 싶었는데
RTX 5070TI 성능 테스트나 하자 하고 바로 환경 구축해서 바로 분류 작업에 투입해봤음
투입결과
속도 보자마자 바로 섹스 소리 나오더라
정확도는 대충 95퍼 정도 였고 뭔가 이상한게 있다 싶으면 유저들이 자막을 구글시트에 올려둬서 그걸로 보고 고치면 됐음
음성에 따라 남성 여성 분류하는것도 구현은 했는데 목소리 피치 정확도가 70퍼 밖에 안돼서 그냥 폐기함
ai로 제작한 한국어 음성을 다운로드하면 저렇게 파일명으로 저장되는데 제작한 스크립트를 실행하면
이런식으로 숫자로된 원본 파일명을 복사해서 그대로 한국어로 분류 및 모드 제작에 쉽게 별도 파일들만 모이게 끔 제작했음
더빙 자동화도 구현은 했는데 상황에 맞는 감정을 ai가 읽지를 못해서 아쉽지만 폐기
그래도 이제 듣고 더빙 파일 제작만 내가 하면 됨
나머지는 싹다 자동화 시켜둬서 이제 유지보수 및 신규 더빙 제작 시간이 20배는 빨라진거 같음
대사 100개 정도 만드는데 한 4일에서 5일 걸렸는데 이제는 1000개 제작하는데 2일이면 가능할지도?
암튼 도움준 헬붕이에게 감사하다고 말해주고 싶고 더빙모드는 더 좋게 만들어서 조만간 배포할게
와우 개쩐다 섹스;
더빙조아
와 ㄷㄷㄷㄷ
ai 진짜 무섭게 편하네
이거 모델 뭐 쓰는 거임?
AI가 음성을 듣고 STT할 때 그냥 영문 스크립트만 텍스트로 적는게 아니라 음성 타임라인에 따라 감정도 한국어 음성 생성하는 AI가 받을 수 있는 감정 프롬프트로 만들어도 좋음. 한글 자막 색인할때는 감정 타임라인 제외하고 영문 스크립트로만 색인하고 색인도 단순 탐색이 정확도 95%나오면 AI가 유사도로 색인하게 만들면 보완할 수 있을거야. 그리고 한글 자막에 아까 영문 음성에서 생성한 타임라인대로 한글 스크립트 중간 중간에 AI가 알아서 감정 프롬프트 삽입하거나 타임라인 형식으로 넘길수 있으면 넘겨서 생성시키면 감정 표현이 주입되서 생성될거임 물론 감정에 따른 톤이나 말투 속도 등은 미리 휴리스틱 데이터 셋을 만들면 캐릭터별로 퍼스널라이징할 수 있을거임 - dc App
잘된다니깐 다행이다 - dc App
@토드_하워드 덕분에 잘 발전시킬수 있었다 음성도 나중에 테스트 해볼게 고맙다!
와...
필요하면 성우 더빙 지원가능, 필요시 연락줘 - dc App
점점 발전해서 좋다
정비병 나와!!!
얘 어디 스카웃되는거 아니냐
성우지망생인 나로선 이 오토마톤 기술력에 두려움을 느낀다