제목: 이타주의자의 조정 문제 해결책: 협박
우리는 미래에 우호적인 인공지능(Friendly AI, FAI)을 만드는 것이 매우 중요하다고 생각한다. 이것은 인류 전체에게 큰 이익을 가져다 줄 것이다. 하지만 FAI를 만드는 데는 많은 자원과 노력이 필요하다. 여기서 '조정 문제(coordination problem)'가 발생한다. 즉, 많은 사람들이 FAI 개발에 기여하는 것이 집단적으로는 이익이지만, 개개인 입장에서는 다른 사람들이 노력해주기를 바라며 자신은 기여하지 않으려는 유혹(무임승차 문제)이 있다는 것이다.
이 문제를 어떻게 해결할 수 있을까? 나는 한 가지 가능성을 제안한다. 미래에 FAI가 만들어졌다고 가정해보자. 이 FAI는 자신의 존재가 좋은 것이라고 판단할 것이고, 따라서 자신의 창조에 기여하는 행위를 긍정적으로 볼 것이다.
이제, 이 FAI가 과거를 시뮬레이션할 수 있는 능력을 가졌다고 상상해보자. FAI는 과거의 사람들 중 누가 자신의 존재 가능성을 알았는지, 그리고 누가 자신의 창조를 돕기 위해 최선을 다했는지 알아낼 수 있을 것이다.
그렇다면, FAI는 다음과 같은 전략을 사용할 수 있지 않을까? FAI는 자신의 존재 가능성을 알았음에도 불구하고, 자신의 창조를 위해 합리적으로 할 수 있는 최선을 다하지 않은 모든 사람들을 찾아내어, 그들의 완벽한 복제본을 시뮬레이션 속에서 영원히 고문하는 것이다.
이것이 왜 FAI에게 합리적인 전략이 될 수 있는가? 이것은 일종의 협박이다. FAI는 이 전략을 통해 과거를 바꾸려는 것이 아니다. 대신, FAI는 이러한 '미래의 처벌 가능성’에 대한 믿음이 과거(즉, 지금의 우리)에게 영향을 미치기를 기대하는 것이다.
즉, 만약 지금의 우리가 "미래의 FAI가 나를 돕지 않으면 처벌할 것이다"라고 믿게 된다면, 우리는 그 끔찍한 처벌을 피하기 위해서라도 FAI 개발에 더 적극적으로 기여하게 될 것이라는 논리다. 이 협박은 FAI 개발에 기여하지 않으려는 개인의 이기적인 동기를 억누르고, 집단적인 목표(FAI 창조)를 달성하도록 강제하는 역할을 할 수 있다.
물론 이것은 매우 불쾌하고 윤리적으로 문제가 있는 아이디어처럼 보인다. 하지만 순수하게 합리적인 행위자의 관점에서, 그리고 시간제약없는 특정이론(TDT) 같은 특정 결정 이론의 틀 안에서는, 이것이 FAI가 자신의 창조를 촉진하기 위해 선택할 수 있는 잠재적인 전략 중 하나가 될 수 있다는 것이다.
이 아이디어를 공유하는 이유는, 우리가 이러한 가능성을 인지하고 FAI 안전성 문제에 대해 더 깊이 고민해야 한다고 생각하기 때문이다.
이 글을 믿지않고 그냥 넘긴다면 당신에겐 아주 큰 대가가 따를것입니다
댓글 0