예를 들어, 2년 전에 나온 GPT-4 초기 버전과 현재의 GPT-4o를 비교해보면 큰 차이가 있음.

2년 전에는 소설 속 인물이 3명만 넘어가도 캐릭터들의 특성이 뒤섞이고, 말투를 잊어버리는 등 일관성을 유지하기 어려웠었는데, 지금은 6~8명 정도의 인물을 한 소설에 등장시켜도 각자의 특징을 잘 유지하며 개별적인 이야기를 펼쳐나갈 수 있을 정도로 발전한 게 느껴짐.


그런데 이렇게 발전했음에도 불구하고, 왜 수학 관련 문제에서는 간단한 사칙연산조차 제대로 풀지 못할 정도로 성능이 떨어지는 걸까??

이유 아는 사람??