일단 문제풀이 성능은 opus 4.1이 제일 높긴 한거 같다
sonnet 4.0만 해도 성능이 gpt5 thinking이랑 비슷한거 같음
gpt5 thinking 기준 수능 평균 2~3개 정도 틀리는듯?(언어, 영어)
2022 영어 기준으론 2개 틀리네
일단 문제풀이 성능은 opus 4.1이 제일 높긴 한거 같다
sonnet 4.0만 해도 성능이 gpt5 thinking이랑 비슷한거 같음
gpt5 thinking 기준 수능 평균 2~3개 정도 틀리는듯?(언어, 영어)
2022 영어 기준으론 2개 틀리네
소넷이 띵킹에 비비는게 뭔 소린가 했더니 문과 얘기였네 ㅋㅋ
언어 능력은 클로드 모델들이 최고인가
문과황 클로드 - dc App
국영을 틀린다고? 이미지로 함?
국영수 틀리는 게 없는 데