๋ฅ๋ง์ธ๋ ์ฐ๊ตฌ์ง์ด ๋จธ์ ๋ฌ๋์ ํ ์์ญ์ธ ๊ฐํํ์ต(Reinforcement Learning)์ด ๋จธ์ง์์ ๋ฏธ๋ ์ธ๊ฐ์ ์ธ์ง ๋ฅ๋ ฅ์ ๋ณต์ ํ๊ณ ๋ฒ์ฉ์ธ๊ณต์ง๋ฅ(Artificial General Intelligence, AGI) ์์ค์ผ๋ก ๋ฐ์ ํ ๊ฒ์ด๋ผ๊ณ ์ฃผ์ฅํ๋ค.
์ด๋ค์ โ๋ณด์์ด๋ฉด ์ถฉ๋ถํ๋ค(Reward is Enough)โ๋ ์ ๋ชฉ์ ๋ ผ๋ฌธ์ โ์ธ๊ณต์ง๋ฅ ์ฐ๊ตฌ ์ ๋(The Journal of Artificial Intelligence Research)โ์ ์ง๋ 5์ 24์ผ ๋ฐํํ๋ฉฐ โ๊ฐํํ์ต์ด AGI๋ฅผ ๋ฌ์ฑํ๋ ์์ ์ ๊ฑฐ์ ๋ชจ๋ ์ธ์ง ์์ ์์ ์ธ๊ฐ์ ๋ฅ๊ฐํ๋ AI๊ฐ ํ์ํ ๊ฒโ์ด๋ผ๊ณ ์์ธกํ๋ค.
๋๋ถ๋ถ ํ์ยท์ฐ๊ตฌ์๋ค์ด โ์ ์ด๋ ๋ค์ 10๋ ์์ ์ธ๊ฐ ์์ค์ ์ธ๊ณต์ง๋ฅ์ด ์ฑ์ทจ๋ ๊ฐ๋ฅ์ฑ์ ๋ํด ๊ธ์ ์ ์ผ๋ก ์ ๋งํ๊ณ ์๋คโ
์ด๋ฒ์ ๋ ผ๋ฌธ์ ๋ฐํํ ๋ฅ๋ง์ธ๋ ์ฐ๊ตฌ์๋ค๋ ๋ง์ฐฌ๊ฐ์ง๋ค. ์ด๋ค์ ๋ ผ๋ฌธ์์ โAGI๋ ๋จธ๋๋จผ ํ์์ด ์๋๋ค. ๋๋ถ๋ถ์ ์ฌ๋๋ค์ด ์๊ฐํ๋ ๊ฒ๋ณด๋ค ๋ ๋นจ๋ฆฌ ์ฐ๋ฆฌ์๊ฒ ์ฌ ๊ฒโ์ด๋ผ๊ณ ์ ๋งํ๋ค. ์ด ๊ฐ์ ์ฃผ์ฅ์ ๊ทผ๊ฑฐ๋ ๊ฐํํ์ต์ ์๋ค.
๋ท๋ถ
AGI ๋ฉ์๋ค๋ ์ฌ๋๋ค ๋ณด์ฌ์ ํ๋ฒ ๋ ์ฌ๋ ค๋ด
์ ๊ณง์ด๋ผ๋ ์์ ์ด ์ธ์ ์ธ๋ฐ ๋๋์ฒด ใ ใ ใ