당연하다고 생각할수도 있고 모를수도 있는 내용인데
딥러닝 모델에서 제일 효과적인 검열 방법은 학습을 반대로 시키는거임
그러니까, 특정 욕설이나 혐오 문구가 있으면 그거를 반대로 학습시켜서 더이상 그 문구가 나오지 않게 하는거임
5년전에 gpt3 나왔을때 기억남?
그때도 LLM 파라미터 늘리니까 갑자기 성능 확 올라가고, 입력에 예시 주면 성능 팍팍 올라간다 그랬잖아?
5년이 지난 지금도 각 요소 혹은 학습한 내용이 정확히 LLM의 어떤 부분에, 어떤 상황에 영향을 주는지 파악하기 어려움
근데 이런 식으로 거꾸로 학습시키는 찐빠를 내면 당연히 지랄남
이건 불과 반년전에 나온 LLM 검열 방법임 (https://arxiv.org/pdf/2408.04983)
자기네가 시도한 방법(회색 부분) 이 '다른 방법들에 비해 검열할 부분만 검열하고 나머지 부분은 살린다' 라고 주장하는건데
중간 컬럼에 perplexity랑 MAUVE라는 평가항목 보임?
이거는 로그단위로 생각하면 됨. perplexity는 낮으면 낮을수록 좋은데, 20인거랑 10인거랑은 성능이 2배가 아니라 4배 차이가 나는 지표임.
제아무리 뛰어난 검열 방법이라도 검열 대상 외 데이터셋에 대해서 original (맨 위, 검열 안한 버전) 에 비해 perplexity가 현저히 높지?
MAUVE도 마찬가지임. 일정 수준 이상에서는 95~이상으로 수렴하는게 정상인 평가방법임. 일부러 그래서 2.7B짜리 요즘 쓰지도 않을 초소형 언어모델을 쓴건데,
그런걸 썼음에도 불구하고 성능이 현저히 하락해버리는거임.
네이버 하이퍼클로바X는 이런 검열을 진짜 악착같이 해서 내놓은 모델임
결국 cue:라고 하이퍼클로바X 탑재한 검색모델은 당일 날짜가 언제인지도 모르는 병신이 되었음
근데 국회에서 네이버 AI 아자 이러고 있는거 보니까 좀 좇같네 ㅋㅋ
유교벌레새끼들이 뭔 ai냐고 한 소리 들어도 할 말 없음
유권자라시는 분들께서 검열을 원하시는데 어카겠음
클로바 진짜 검열 존나 심하더라
간만에 특갤에 사람이 쓴글이 올라왓네
글쓰느라 30분 걸렸는데 사람 컷 개높네;;
미국 따라가기엔 돈이랑 인력이 없고 중국 따라가기엔 저작권이랑 검열이 무섭고 이도저도 아닌 모양새. 진짜 hail mary라도 할거면 우리가 할 수 있는건, 사실상 무검열로 최대한 달리는건데, 이것조차 못 하는 현실이 아쉽네.
왜 이 나라는 검열을 못해서 안달인걸까? 존나웃긴건 그냥 보여지는것만 검열존나함 이상하게 관심없는 분야는 걍 허벌창인게 많음
예를 들어 그냥 활같은거 걍 쿠팡에서 파는것도 그렇고
안달이 난 사람도 없고 검열에 목숨거는 사람도 없음 지만 살면 장땡인 사람들만 있을 뿐이지
걍 민주주의와 표현의자유를 그냥 공짜로 주입받아서 그런게 아닌가 싶다
원래 하클 성능 좋았음?
그건 아닌데 그 이전 모델은 논문도 내고 좋았던걸로 기억함
그럼 정치권에서 하클 묻어버린 거임? 하클 소식이 워낙 없어서 잘 모르겠음
그건 아닌데, 애초에 검열을 안하면 안되는 분위기가 조성된것도 있고, '최대한 검열' 하려고 하면 성능이 말도 안되게 떨어지니까 짜증나서 써봄
내가 이래서 검열 개싫어하는데 박태웅 그 인간은 또 100분토론 나와서 검열의 중요성만 강조하고 있더만
ㄹㅇ ㅋㅋㅋ 좆병신 검열충새끼들 ㅋㅋㅋ - dc App