클로드가 한 언어에서 배운 것을 다른 언어를 구사할 때 적용할 수 있음을 시사합니다. 모델이 여러 맥락에 걸쳐 지식을 공유하는 방식을 연구하는 것은 여러 영역에 걸쳐 일반화되는 모델의 가장 진보된 추론 능력을 이해하는 데 중요합니다.
. 이는 모델이 사람들이 작성한 설명을 모방하여 수학을 설명하는 법을 배우지만, 그러한 힌트 없이 직접 "머릿속으로" 수학을 수행하는 법을 배워야 하고, 이를 위해 자체적인 내부 전략을 개발한다는 사실을 반영할 수 있습니다.
우리는 클로드가 먼저 "댈러스는 텍사스에 있다"를 나타내는 특징들을 활성화한 다음, 이를 "텍사스의 주도는 오스틴이다"를 나타내는 별도의 개념과 연결하는 것을 관찰합니다. 즉, 모델은 암기된 응답을 그대로 뱉어내는 대신 독립적인 사실들을 결합하여 답에 도달하고 있습니다.
이게 진짜라면 클로드가 앵무새라면 우리도 앵무새임
오우ㄷㄷ 정교한 통계는 인간의 지능과 다를게 없는걸까
우리도 앵무새였던거임 ㄷㄷ