... 첫째, STOP은 블랙박스 언어 모델을 변경하지 않으므로 완전한 RSI가 아닙니다. 게다가, 이 시점에서, 우리는 STOP이 만드는 비계 시스템이 전문가들이 손으로 설계한 시스템보다 우월하다고 믿지 않는다. 만약 그렇다면, STOP은 (현재) 추가적인 AI 오용을 허용하지 않는다...
그러나, 폐쇄 모델의 API 기반 미세 조정 기술이 더 많이 이용
익명(121.158)2023-10-27 20:44
답글
가능해짐에 따라(OpenAI, 2023a), 이것들을 개선 루프에 통합하는 것이 그럴듯할 것이다. 따라서, 특히 점점 더 강력한 대형 언어 모델에서 우리의 접근 방식의 일반성을 평가하는 것은 어렵다.
익명(121.158)2023-10-27 20:45
답글
미세 조정은 기본 모델을 변경하는 것을 의미한다. 또한, 나는 저자들이 의도적으로 기본 모델의 재귀적 자기 개선(RSI)을 허용하지 않는다는 것을 지적하고 싶다. 그들은 해석할 수 있기 때문에 코드 생성의 RSI만 허용한다. 이것은 이러한 제한이 제거되면 기본 모델이 빠르고 재귀적으로 자체 개선될 수 있음에도 불구하고 시스템에 엄격한 제약이 부과되고 있음을
https://arxiv.org/abs/2210.11610
이런건 니들이기대하는 재귀개선이 아니잖아 이걸토대로 새로운 ai를 만들어낼수있음? 패러미터를 늘릴수있음? 토큰을늘릴수있음?
https://jacobbuckman.com/2022-09-07-recursively-self-improving-ai-is-already-here/
https://twitter.com/AISafetyMemes/status/1699003113586188386?t=WjQ5leLqpYhnAyYKPCQdag&s=19
https://twitter.com/ylecun/status/1717676624865382901?t=ki7tTbM3S5zT9tzSe2yGEw&s=19
https://arxiv.org/abs/2310.02992
https://m.dcinside.com/mini/linear/8873
... 첫째, STOP은 블랙박스 언어 모델을 변경하지 않으므로 완전한 RSI가 아닙니다. 게다가, 이 시점에서, 우리는 STOP이 만드는 비계 시스템이 전문가들이 손으로 설계한 시스템보다 우월하다고 믿지 않는다. 만약 그렇다면, STOP은 (현재) 추가적인 AI 오용을 허용하지 않는다... 그러나, 폐쇄 모델의 API 기반 미세 조정 기술이 더 많이 이용
가능해짐에 따라(OpenAI, 2023a), 이것들을 개선 루프에 통합하는 것이 그럴듯할 것이다. 따라서, 특히 점점 더 강력한 대형 언어 모델에서 우리의 접근 방식의 일반성을 평가하는 것은 어렵다.
미세 조정은 기본 모델을 변경하는 것을 의미한다. 또한, 나는 저자들이 의도적으로 기본 모델의 재귀적 자기 개선(RSI)을 허용하지 않는다는 것을 지적하고 싶다. 그들은 해석할 수 있기 때문에 코드 생성의 RSI만 허용한다. 이것은 이러한 제한이 제거되면 기본 모델이 빠르고 재귀적으로 자체 개선될 수 있음에도 불구하고 시스템에 엄격한 제약이 부과되고 있음을
시사한다.