나는 외국에서 문서 번역일 하고 있는데, 최근들어서 이번에 처음으로 IT회사 가서 번역일 도와주고 있음
번역한거를 A.I가 학습을 하도록 도와주는 일을 하는데, 녹음하고 나서 평가하는데 영어나 중국어 평가 점수가 평균 80/100 이면 한국어는 30/100 정도 나오는거야.
중국어나 영어나 이런건 띄어쓰기가 많이 없어서 그런가? 아니면 한글이 존나 위대해서 그런거냐? 일반 국민들한테나 위대하고 프로그래머들 한테는 그냥 개 좆같은 언어 같아보이는데? 우리나라가 표음문자에다가 조사도 존나 많이 쓰고 동사변형도 존나 많아서 솔직히 프로그래머들은 존나 좆같은거 같음..
번역할 때 의역하해서 하면 컴퓨터가 학습을 잘 못한다고 해서 평소에 하던 번역이랑 스타일이 많이 달라져서 조금 힘듦.
여기 아저씨들 조금 도움 줄려면 한글 번역할 때 주의할점 뭐가있을까?
그 정도면 그 프로그램이 중국/영어 개발자가 만들어서 그런 문제일 뿐이야
중국어가 쉬운 건 영어를 학습시키면 어순이 중국어가 같잖아
영어를 일본어로 구글 번역하고 영어>일어>한국어가 영어>한국어보다 잘되었던 때가 있었는데 구글 사용자수가 차이가 어마어마해서랬음
인공지능의 경우 학습을 시키는 주체에 따라 그 주체나 데이터에 편향적으로 따라가는 문제가 있음
요새 인공지능을 발로 만들어도 60/100은 한국어가 나와야함 30/100은 프로그래머가 한국어 신경 안 써서 그런 거
아 답변 감사....
인코딩 시발 - dc App
프로그래밍에선 Ascii 빼곤 다 씨발임
중국어보다 어렵진 않을 거 같은데