Just a moment...Just a moment...chatgpt.com
https://chatgpt.com/c/67693c54-146c-8002-9b26-61e671596940
얘는 어려운 미적분학 문제는 잘만 풀면서 조금만 생소한 분야로 가면 추론 능력이 있긴 한가 싶을 정도로 미련해짐
내가 o1 가지고 놀다가 o1한테 특정 조건을 만족하는 튜링 머신을 구성해보라고 시켜봤거든
진짜 단순하게 n개의 1을 입력받고 2n개의 1을 출력하는 튜링 머신을 만들라고 했는데 대화 50개를 다 쓸 지경이 될 때까지 한 번도 성공을 못 함
심지어 틀렸을 때 스스로 틀린 거 깨달아보라고 직접 검토해보라고 시켜도 못 알아채
이게 헷갈리긴 해도 어려운 걸 시킨 건 절대 아니거든 초중딩도 방법만 알려주면 할 수 있음 진짜로
이런 걸 보면 웬만한 분야에서 ChatGPT가 똑똑한 건 그냥 훈련을 빡세게 시켜서 그런 거고 진짜 추론 능력은 없는 것 같음
o3는 얼마나 똑똑할란지 모르겠는데 최소한 o1은 그래보여
LLM 자체가 인간 라벨러 라벨링의 집합체이기 때문에 아직 창의성이나 주제 불문 만능을 기대하면 안됌
환각이 창의성이랑 연관있다는 연구진도 있음