한국 : 자모 24개
일본 : 히라가나 46자+가타가나 46자 = 92자 (한자 제외)
중국 간체자 : 상용한자 3,500자 > 현대 사전 10,000자
대만 번체자 : 상용한자 4,800자 > 현대 사전 13,000자
중국 고사전 : 강희자전 47,035자 > 중문대사전 49,905자
= 유니코드 CJK 한자 수 : 97,058자
이집트, 메소포타미아 다 버린 고대에나 쓰던 상형문자를 아직도 쓰는 문명은 중국뿐
요즘애들 문해력 엉망이라고 빌드업하며 한글 전용 이룩한 나라에 고대 문자 한자 부활 시켜
다가오는 AI 시대에 중국 문명권 소중화로 퇴행시키려는 새끼들이 진정한 매국노다
허허 한글 전산화 하는데 얼마나 고생했는지 모르는구만. 조합문자 특성 때문에 한국어도 완성형 11000자 정도 차지하고 있단다...
오히려 문자 전산화 문제 다 끝나고, 문자 하나 당 형태소~단어 하나를 할당할 수 있다는 거 자체가 AI에겐 이점이라 얘네 생각 가끔 중국어로 한다잖아. 솔직히 수만 자 되는 문자 일일이 외우는 게 힘든 인간한테나 최악의 문자지, 기계한텐 오히려 간편할지도
그 내용은 짤에도 나와 있음. 한글은 이론적 최대치지 실제로 쓰는 글자는 아니고 그만큼 다 외워야 되는것도 아니니 질적으로 차원이 다른 이야기고. 트랜스포머 관점에서 보면 중국어가 영어와 같은 고립어라 유리한 면이 있는건 맞음. 교착어인 한국어/일본어는 어미 변화가 무쌍해서 좀 그렇지.
ㅇㅇ 사실 조합식으로 글자를 찍어내는 구조 때문에 전산화 과정에서 한국어가 별로 좋은 애는 아니긴 함 ㅋㅋ 근데 또 AI기술에 특별히 뭐가 좋다는건 잘 모르겠네.. 한국어가 조사 때문에 토큰 좀 더 많이 나온다는건 본거 같긴한데
잘만하는데 그 한자로 뭔소리하노 - dc App