사용자가 원하는 느낌에 얼마나 가깝게 (+편하게) 뽑을수있냐가 성능이지
퀄리티 따질 단계는 넉넉잡아 10개월 전에 이미 지난듯
저번에도 말했지만 텍스트 말고 오디오 인풋 받는 멀티모달이면 사용자와 사용자의 니즈에 대한 파악이 더 정교해질 수 있음
지금은 사용자도 텍스트로 인풋을 넣고, 그걸 가지고 또 gpt가 텍스트 프롬프트를 만들어서 달리한테 넣어주니까
무슨 얘기를 하는 건지 모르겠음 사용자의 의향을 전달한다는 점에서 오디오는 텍스트의 하위호환 아닌가
음성도 오디오임
그러니까 내 말이 그 말임 음성을 통한 의사전달은 아무리 잘 해도 텍스트와 동급 그 이상은 될 수 없음
네 말이 맞다
저번에도 말했지만 텍스트 말고 오디오 인풋 받는 멀티모달이면 사용자와 사용자의 니즈에 대한 파악이 더 정교해질 수 있음
지금은 사용자도 텍스트로 인풋을 넣고, 그걸 가지고 또 gpt가 텍스트 프롬프트를 만들어서 달리한테 넣어주니까
무슨 얘기를 하는 건지 모르겠음 사용자의 의향을 전달한다는 점에서 오디오는 텍스트의 하위호환 아닌가
음성도 오디오임
그러니까 내 말이 그 말임 음성을 통한 의사전달은 아무리 잘 해도 텍스트와 동급 그 이상은 될 수 없음
네 말이 맞다