본질을 보셈.
정렬은 일종의 AI를 제어하기 위한 한가지 방편에 불과함.
그 외에도
AI에이전트'들'이 서로 견제시스템을 구축
중간 보고 검토 의무화 등등..
그리고 검토 승인 권한을 '인간'에게 부여.
그 외에도 수많은 제어 방법이 존재함.
완벽한 정렬이 필요한게 아니라
그냥 정렬이 필요한 것뿐임.
세상에 완벽한게 어디있음. 그저 확률을 지배하는게 중요한거임.
본질을 보셈.
정렬은 일종의 AI를 제어하기 위한 한가지 방편에 불과함.
그 외에도
AI에이전트'들'이 서로 견제시스템을 구축
중간 보고 검토 의무화 등등..
그리고 검토 승인 권한을 '인간'에게 부여.
그 외에도 수많은 제어 방법이 존재함.
완벽한 정렬이 필요한게 아니라
그냥 정렬이 필요한 것뿐임.
세상에 완벽한게 어디있음. 그저 확률을 지배하는게 중요한거임.
가능한 일은 언젠가 일...
교통사고로 죽을 확률은 언제나 존재함. 그래서 모든 차량을 없애버림?
승인 권한을 '인간'에게 주어도 agi가 그걸 회피하니까 문제지. 일예로 통신망 두절시켜서 명령 회피
그러니까 순진하게 한두가지 방법으로 제약을 거는게 아니라, 여러가지 방편으로 제약을 거는거지. 물론 그것도 회피할 시, AI경찰시스템과 같은 외부 극단 처방도 당연히 존재하고 ㅇㅇ
즉 n차원 제약으로 방비하는거임. 그것을 한개의 agi가 만드는게 아니고 여러개의 agi모델들이 서로 견제하게 해서 ㅇㅇ
에이전트등으로 이름붙이니 통제가능할 거라 착각하기 쉬운데, 정확히는 지능높은 '외계인' 들이고 이들이 인간이 내놓은 규칙을 따르게할 강제력이 없음. 현재 시도하는 정렬이란건 그 외계인들이 고양이마냥 천성적으로 인간을 귀여워하도록 미리 뇌수술을 하는것에 가까움. 당연히 그게 가능할지, 성공할지는 아무도 모르고, 등장을 막는것은 불가능하니 일반인은 기도나 하는수밖에.
완벽하게 통제를 바라는게 아님. 기도 메타도 괜찮은데 ㅇㅇ 그저 최근에 정렬만 가지고 불타오르니 의미없다고 하는거 ㅇㅇ