https://m.dcinside.com/board/thesingularity/394182?page=2

수학문제를 왜 제대로 풀 수 없는지? 에 대해서일단 왜 알파고같은 접근이 불가능한가??rl은 원래 시뮬레이션 환경에서 어떤 상태에서 어떤 액션을 했을 때 그게 몇점짜리 액션인지 (최종적으로 게임이 끝날때 이길지 말지) 를 reward로 받아서 그게 높으면 그 액션m.dcinside.com

yann lecun이나 deepmind llm head가 하는말처럼
이런식으로는 끝이없음

성능 개선은 계속 있겠으나 breakthrough는 힘들거임

2024 agi가 된다는건 지금 아예 차원이 다른 새로운 알고리즘이 이미 연구단계에서 검증이 끝니고 대형모델로 스케일업을 하고 있다는 소린데

전혀 그런 기미가 안보임