[2205.09712] Selection-Inference: Exploiting Large Language Models for Interpretable Logical Reasoning (arxiv.org)

초둝

LLM(Large Language Model)은 μƒˆλ‘œμš΄ μž‘μ—…μ— λŒ€ν•œ 인상적인 λͺ‡ 번의 μΌλ°˜ν™”λ₯Ό μˆ˜ν–‰ν•  수 μžˆλŠ” κ²ƒμœΌλ‘œ λ‚˜νƒ€λ‚¬μŠ΅λ‹ˆλ‹€. κ·ΈλŸ¬λ‚˜ 그듀은 μ—¬μ „νžˆ 닀단계 논리적 μΆ”λ‘  λ¬Έμ œμ—μ„œ μ œλŒ€λ‘œ μˆ˜ν–‰ν•˜μ§€ λͺ»ν•˜λŠ” κ²½ν–₯이 μžˆμŠ΅λ‹ˆλ‹€. μ—¬κΈ°μ—μ„œ 논리적 μΆ”λ‘ μ˜ λ‹€μ–‘ν•œ 츑면을 μ‘°μ‚¬ν•˜λŠ” 50개 μž‘μ—…μ— λŒ€ν•œ LLM에 λŒ€ν•œ 포괄적인 평가λ₯Ό μˆ˜ν–‰ν•©λ‹ˆλ‹€. μš°λ¦¬λŠ” μ–Έμ–΄ λͺ¨λΈμ΄ 단일 단계 μΆ”λ‘  λ˜λŠ” 수반 μž‘μ—…μ—μ„œ μƒλ‹Ήνžˆ 잘 μˆ˜ν–‰ν•˜λŠ” κ²½ν–₯이 μžˆμ§€λ§Œ 더 λ³΅μž‘ν•œ 문제λ₯Ό ν•΄κ²°ν•˜κΈ° μœ„ν•΄ μ—¬λŸ¬ μΆ”λ‘  단계λ₯Ό ν•¨κ»˜ μ—°κ²°ν•˜λŠ” 데 어렀움을 κ²ͺλŠ”λ‹€λŠ” 것을 λ³΄μ—¬μ€λ‹ˆλ‹€. 이에 λΉ„μΆ”μ–΄ μš°λ¦¬λŠ” 사전 ν›ˆλ ¨λœ LLM을 일반 처리 λͺ¨λ“ˆλ‘œ ν™œμš©ν•˜κ³  선택과 좔둠을 λ²ˆκ°ˆμ•„ κ°€λ©° μ΅œμ’… λ‹΅λ³€μœΌλ‘œ μ΄μ–΄μ§€λŠ” 일련의 해석 κ°€λŠ₯ν•œ μš°μ—°ν•œ μΆ”λ‘  단계λ₯Ό μƒμ„±ν•˜λŠ” SI(Selection-Inference) ν”„λ ˆμž„μ›Œν¬λ₯Ό μ œμ•ˆν•©λ‹ˆλ‹€. λ―Έμ„Έ μ‘°μ • 없이 5단계 μΌλ°˜ν™” μ„€μ •μ—μ„œ SI ν”„λ ˆμž„μ›Œν¬ λ‚΄μ—μ„œ μ‚¬μš©λœ 7B λ§€κ°œλ³€μˆ˜ LLM이 10κ°€μ§€ 논리적 μΆ”λ‘  μž‘μ—… λͺ¨μŒμ—μ„œ λ™λ“±ν•œ κΈ°λ³Έ κΈ°μ€€κ³Ό λΉ„κ΅ν•˜μ—¬ 100% μ΄μƒμ˜ μ„±λŠ₯ ν–₯상을 κ°€μ Έμ˜¨λ‹€λŠ” 것을 λ³΄μ—¬μ€λ‹ˆλ‹€. λ™μΌν•œ μ„€μ •μ˜ λ™μΌν•œ λͺ¨λΈμ€ λ™μΌν•œ μž‘μ—… μ œν’ˆκ΅°μ—μ„œ 훨씬 더 큰 280B λ§€κ°œλ³€μˆ˜ 기쀀선보닀 μ„±λŠ₯이 훨씬 λ›°μ–΄λ‚©λ‹ˆλ‹€. λ˜ν•œ SI ν”„λ ˆμž„μ›Œν¬μ— μ˜ν•΄ μƒμ„±λœ λ‹΅λ³€μ—λŠ” 인과적 μžμ—°μ–΄ 기반 μΆ”λ‘  좔적이 수반되며, μ΄λŠ” μ‹œμŠ€ν…œμ˜ μ•ˆμ „μ„±κ³Ό 신뒰성에 μ€‘μš”ν•œ 영ν–₯을 λ―ΈμΉ©λ‹ˆλ‹€.


κ²°λ‘ 
μš°λ¦¬λŠ” μžμ—° μ–Έμ–΄λ‘œ ν‘œν˜„λœ 논리적 μΆ”λ‘  문제λ₯Ό ν•΄κ²°ν•˜κΈ° μœ„ν•΄ 사전 ν›ˆλ ¨λœ μ–Έμ–΄ λͺ¨λΈμ˜ λŠ₯λ ₯을 ν–₯μƒμ‹œν‚€κΈ° μœ„ν•œ 선택-μΆ”λ‘  ν”„λ ˆμž„μ›Œν¬λ₯Ό μ œμ‹œν–ˆμŠ΅λ‹ˆλ‹€. 우리의 μ ‘κ·Ό 방식은 논리적 좔둠을 μΆ”λ‘  정확도λ₯Ό 크게 ν–₯μƒμ‹œν‚¬ 뿐만 μ•„λ‹ˆλΌ 인과적 해석 κ°€λŠ₯ν•œ μΆ”λ‘  좔적을 μƒμ„±ν•˜λŠ” λͺ¨λ“ˆμ‹ μž¬κ·€ νŒŒμ΄ν”„λΌμΈμœΌλ‘œ λΆ„ν•΄ν•˜κΈ° μœ„ν•΄ μ‹ κ²½ 기호 μ ‘κ·Ό λ°©μ‹μ˜ λͺ¨λ²” 사둀λ₯Ό μ°¨μš©ν•©λ‹ˆλ‹€. μš°λ¦¬λŠ” SI ν”„λ ˆμž„μ›Œν¬μ— μ‚¬μš©λœ ν”„λ‘¬ν”„νŠΈ μ—”μ§€λ‹ˆμ–΄λ§ LLM이 λ™μΌν•œ μ„€μ •μ—μ„œ ν‰κ°€λœ κΈ°λ³Έ 및 COT κΈ°μ€€μ„ κ³Ό 심지어 40λ°° 더 큰 기쀀선을 훨씬 λŠ₯κ°€ν•œλ‹€λŠ” 것을 μž…μ¦ν–ˆμŠ΅λ‹ˆλ‹€. SI ν”„λ ˆμž„μ›Œν¬μ˜ μ„±λŠ₯은 단계별 μΆ”λ‘  데이터λ₯Ό μ‚¬μš©ν•  수 μžˆλŠ” 경우 λ―Έμ„Έ 쑰정을 톡해 λ”μš± ν–₯상될 수 μžˆμŠ΅λ‹ˆλ‹€. μΊμ£Όμ–Όν•˜κ³  해석 κ°€λŠ₯ν•˜λ©° λ…Όλ¦¬μ μœΌλ‘œ μœ νš¨ν•œ 닀단계 좔둠이 κ°€λŠ₯ν•œ λͺ¨λΈμ€ 법λ₯ , μ˜ν•™, κ³Όν•™, μˆ˜ν•™, 경제 및 기타 μ‹ λ’°ν•  수 있고 검증 κ°€λŠ₯ν•œ 논리적 좔둠이 μ€‘μš”ν•œ λΆ„μ•Όμ—μ„œ 잠재적으둜 적용될 수 μžˆμŠ΅λ‹ˆλ‹€. λ™μ‹œμ— μš°λ¦¬λŠ” μ΄λŸ¬ν•œ 섀정에 λ°°ν¬ν•˜κΈ° 전에 μ΄λŸ¬ν•œ λͺ¨λΈμ„ ν‰κ°€ν•˜κΈ° μœ„ν•΄ νŠΉλ³„ν•œ μ£Όμ˜κ°€ ν•„μš”ν•˜λ‹€λŠ” 것을 μ•Œκ³  μžˆμŠ΅λ‹ˆλ‹€. 예λ₯Ό λ“€μ–΄ 선택 λͺ¨λ“ˆμ„ κ°œμ„ ν•˜κΈ° μœ„ν•œ μΆ”κ°€ μž‘μ—…λ„ ν•„μš”ν•©λ‹ˆλ‹€(예: λͺ¨λΈ 검색을 ν—ˆμš©ν•˜κ³  λ‹€μ–‘ν•œ μΆ”λ‘  좔적을 평가). 쀑단 문제λ₯Ό ν•΄κ²°ν•˜κΈ° μœ„ν•΄(선택을 쀑단할 λ•Œμ™€ μ „λ°˜μ μΈ 좔둠을 쀑단할 λ•Œ λͺ¨λ‘) 잘λͺ»λœ 좔둠이 μ»¨ν…μŠ€νŠΈμ— μΆ”κ°€λ˜λŠ” 것을 λ°©μ§€ν•˜λŠ” 데 도움이 λ˜λŠ” κ²€μ¦μžλ₯Ό ν†΅ν•©ν•©λ‹ˆλ‹€. μ‹œμŠ€ν…œμ΄ 데이터 μ„ΈνŠΈμ—μ„œ μ œκ³΅λ˜λŠ” 것에 μ˜μ‘΄ν•˜μ§€ μ•Šκ³  자체 κ΄€λ ¨ μ»¨ν…μŠ€νŠΈλ₯Ό μ œκ³΅ν•  수 μžˆλ„λ‘ ν•©λ‹ˆλ‹€. λͺ¨ν˜Έν•˜κ±°λ‚˜ λŒ€λ‹΅ν•  수 μ—†λŠ” μ§ˆλ¬Έμ„ μ²˜λ¦¬ν•˜λŠ” μ‹œμŠ€ν…œμ˜ λŠ₯λ ₯을 ν™•μž₯ν•©λ‹ˆλ‹€.