단순히 토크나이저가 그렇게 설계되어 있어서 피할 수 없는 거고 그걸 부분적으로나마 극복했다는게 대단한건데 왜 아직도 그거가지고 선동하는걸까 결국 o1 preview만 해도 학식 수준 코딩은 1분만에 하고 o1은 코드포스 최상위 문제도 푸는데 코딩 천재가 strawberry r 갯수 못센다고 저능아인거 아니잖아 실수가 있을 뿐이지
질문을 스트로베리 단어 전체 알파벳에서 r의 개수로 바꾸면 답하지 않을까
그냥 llm한테는 '알파벳'이라는 개념이 없음 strawberry는 3812번 r은 2941번 딸기는 19381번 이런식으로 작동함
ㄴ 그럼 그게 한계인거네 ㅇㅇ 기본적인 인간도 하는걸 못한다? 결국 인간의 개입과 보조가 필수적이란거지 ㅇㅇ
ㄴ 너는 +++++++++ ++++의 발음 모르잖아. ai는 앎. 서로 다른 종류의 지능인거임
ㄴ 아랍어 입력이 안되뇨
그니까 여기서 바라는것처럼 노동의 완전대체는 불가능하단거임 지능의 성격이 다르면 여전히 인간노동자는 ai의 보조용으로 필요하단건데
ㄴ r 개수 새는건 토크나이저 구조만 바꾸면 되는데, 그러면 가격이 비싸지니까 아무도 안하는거임 각 단어를 토큰화하지 않고 문자 단위로 쓰면 가격 최소 5배는 비싸짐.
인간과 다른 형태인건 당연한거고 중요한건 그래서 얘네한테 일 시킬수 있냐는거지 r개수 모르는 그 자체가 문제가 아니라 부정확성이 문제임
ㄴ바로 그게 한계란거임 받아들이셈 그런 사소한 차이로 생기는 오류로 막대한 피해가 발생할 수 있는데 인간노동자 대체가 가능하겠음?
기업은 상업성이 있으면 무엇이든 자동화하고자 함
ㄴ잘 말해줬음. 바로 그 상업성이 없으니까 안하는거임. 선형충 이외엔 strawberry의 r개수를 물어볼 사람은 흔치 않으니까
코포 최상위 문제 못 풀던데? 핵심 아이디어를 주고 만들어보라고 해도?
preview랑 미공개 o1이랑 점수 두배차이는건 확인했고?
웰노운 어려운 거는 잘 풀어도 애드혹 쉬운 걸 못 풂 그 점수 한 것도 랜덤하게 문제 뽑아서 한 게 아니라 최대한 웰노운으로 높게 점수 찍도록 유도한 거임
ㄴ 그니까 네가 o1 preview랑 mini말고 정식버젼 써봤냐고 ㅇㅇ
ps 해본 적이 없지 친구야? 애초에 코포가 뭔지도 잘 모르는 거 같은데 정식 버전은 그냥 추론 시간을 몇 배 단위로 키워서 로그스케일로 성능이 증가하니까 그거 증가시킨 건데 그런다고 해서 애드혹을 잘 풀지는 못한다고 ㅋㅋ
애드혹 문제는 못푸는거 분명 있을거임. 기존에 아예 없는 문제를 인간 최상위권 레벨로 전부 코딩칠 수 있으면 o1이 AGI라고 홍보했겠지