viewimage.php?id=3fb8d122ecdc3f&no=24b0d769e1d32ca73ded83fa11d0283177940c12fe472eea84be03aa986912b3139795d4b88986e53ad8d20f1dc2377ca2bd467fea7d99ef255ddc27c7af11d60fb0c30d35c0d1e2d69bdc3fa2d7d2770194c39fcfabbc6598a71cdd7d4086c38411431d872c9f

viewimage.php?id=3fb8d122ecdc3f&no=24b0d769e1d32ca73ded83fa11d0283177940c12fe472eea84be03aa986912b3139795d4b88986e53ad8bf6216cf307aefc1ef08756638306f0a57db5f4f43725d95a1e08de6686122c6f5a38c8cd3402a6810666fb6ef8642de42c34f800f029a23631ac364b368

viewimage.php?id=3fb8d122ecdc3f&no=24b0d769e1d32ca73ded83fa11d0283177940c12fe472eea84be03aa986912b3139795d4b88986e53ad8bf6216cf307aefc1ef08756638686d5957d8584a1672cb8e38c371f6aa4fa9285581224eb4dda6ba58b310e52abd1fcc0ff68f6876ca928597f2db33238b

viewimage.php?id=3fb8d122ecdc3f&no=24b0d769e1d32ca73ded83fa11d0283177940c12fe472eea84be03aa986912b3139795d4b88986e53ad8bf6216cf307aefc1ef087566383e61505bdc091c4d721f9a70f2eae474ea392b753e4727f58de79addcbdd23302e04a93daedf9400b8c8d603d9adeb482d

세계2차대전 시대즈음 Cobert라는 인간이 Missing spieces 문제를 제안함. 뭐냐면 그 냥반이 2년동안 말레이시아에서 나비 표본을 수집했는데, 이걸 가지고 앞으로 1년 더 머물렀을때 추가로 발견할수 있는 새로운 나비 종의 개수를 추정하고 싶던것.

얼핏 생각해보면 이 문제 답이 없어보임. 새 나비 종이라 하면 지금까지 수집하지 못한, 즉 자료가 없단 얘긴데 어케 그걸 추측하고 근거를 대지?? 짱구를 굴려도 답이 안나오자 이 문제를 당대 네임드 통계학자인 Fisher에게 가져다 줬는데, 놀랍게도 완전 깔끔한 방식으로 추정치를 구함. 자세한 방식은 저 책 찾아보시고 (Efron의 CASI; 저자가 무료로 공개해놓음)

이 방식을 셰익스피어 작품에 적용을 할수있음. 셰익스피어가 작품에 새로운 단어들을 많이 만들어 쓴다는 사실(이라고 나옴... 전 잘 몰름;)에 착안, 아까 방식을 이용하면 셰익스피어의 미발표작에서 튀어나올 새로운 단어 개수의 추정치를 구할 수 있음 (단어를 나비 종으로 생각하는겨). 실제로 1985년에 셰익스피어가 썼을것으로 추정되는 짧은 시(429단어)가 발표된 적이 있는데, 저 분석법을 적용했을때 새 단어 개수의 기대값이 6.97개로 나왔고 실제 시에 있는 새로운 단어들은 9개였다고 함.

물론 그렇다고 ‘셰익스피어가 저 시 쓴거임 ㅅㄱ’라고 확언할수는 없지만, 하나의 정황증거 정도는 제시한다는 점에서 의의가 있다 이말이야