나도 긴가민가해서 허깅 페이스 가이드 문서보고 이야기했는데 같은 개념이라고 보니 나는 어이가 없음
댓글 77
파인애뽀 튜닝 ㅇㅅㅇ
류도그담당(211.235)2025-05-15 14:47
뭘 보라는 얘기임? 울지말고 얘기해봐. 니가 생각하는 파인튜닝이 뭔데?
troublecoder(troublecoder)2025-05-15 14:47
답글
허깅 페이스 파인튜닝 예시보면 LLM 데이터셋으로 재학습이라고 말하는데 뭔소리임
ㅆㅇㅆ(124.216)2025-05-15 14:49
난 같은 개념이라고 얘기한적도 없는데 혼자 망상에 빠짐?
troublecoder(troublecoder)2025-05-15 14:48
당연히 전처리,후처리,파인튜닝은 전혀 다른 문제임
troublecoder(troublecoder)2025-05-15 14:48
답글
그럼말을 왜 그렇게함? 말장난좀 하지마라 쳐맞을려고
ㅆㅇㅆ(124.216)2025-05-15 14:49
답글
내가 언제 말을 그렇게 함? 진짜 웃기네?
troublecoder(troublecoder)2025-05-15 14:50
답글
너가 어떻게 말했는지 보여줌?
--
troublecoder .도메인이랑 서비스에 맞게 바꾸는걸 우리식 용어로는 파인튜닝이라고 한단다..
--
라매
ㅆㅇㅆ(124.216)2025-05-15 14:50
답글
그거 아니라고
ㅆㅇㅆ(124.216)2025-05-15 14:50
답글
걍 씨발 몰랐으면 인정하면 될껄 키배 이길라고 아득바득 되네 짜증나게 uv 가르쳐줘서 좀 좋게 좋게 넘어갈랬는데
ㅆㅇㅆ(124.216)2025-05-15 14:50
답글
혼자 확대해석함?
troublecoder(troublecoder)2025-05-15 14:51
답글
니가 말한 vLLM 서빙은 한계가 명확하고, 당장 허깅 페이스에서도 저렇게 쓰라고 말한 예시 가지고 이야기중인데 니가 말한 프롬프트 엔지니어링에도 한계가 있어서 제대로 쓸려면 파이썬으로 써야한다고 이야기했는데 아니라고 우긴건 넌데?
ㅆㅇㅆ(124.216)2025-05-15 14:51
답글
@troublecoder
느그식 용어로는 도메인이랑 서비스에 맞게 바꾸는걸 파인튜닝이라고 한다매 ㅋㅋㅋ 그렇게 넓게 안쓴다고 파인튜닝을.
ㅆㅇㅆ(124.216)2025-05-15 14:52
답글
음..어디 아프냐? vllm의 서빙 한계와 파인튜닝과 전,후처리는 전혀 상관이 없어. 난 그냥 굳이 llm 붙이는데 파이썬을 쓸 필요가 없다는걸 말하는거임. 파인튜닝은 그냥 툴킷 쓰면 되고 전후처리야 앞뒷단에서 언어 맘대로 골라 쓸수있는데
troublecoder(troublecoder)2025-05-15 14:52
답글
@troublecoder
vLLM은 일관된 컨텍스트 보장이 어렵기때문에 세부 제어를 위해서 사실상 상용한 제품화로 쓸려면 파이썬 써야한다는거고, 이거는 기업 레벨 아닌이상 당연한거임. 기업레벨에서튜닝해서 쓸수있지만 개인 개발 단위에서는 내 말이 맞는데. 이거 허깅 페이스 문서 읽고 말한거임
ㅆㅇㅆ(124.216)2025-05-15 14:53
답글
아프면 병원 가라.. 혼자 확대해석하고 발끈한거네
troublecoder(troublecoder)2025-05-15 14:53
답글
vllm의 역할은 서빙인데 일관된 컨텍스트 얘기는 왜 나오냐?
troublecoder(troublecoder)2025-05-15 14:54
답글
@troublecoder
뭔 소리임 대체. 니가 쓴 저 댓글은 뇌리에서 지움? 왜 자꾸 말싸움 이길라고 같잖은 말장난질이냐
@troublecoder
그게 모델 재조정이고, 니가 말한 vLLM이랑 다르다고,
뭔가 제대로 알지 못하는 느낌이고
파인튜닝 adapts는 모델 의 가중치를 바꾼다는 뜻임
ㅆㅇㅆ(124.216)2025-05-15 14:59
답글
컨텍스트 최적화가 뭘 말하는거냐? 정확하게 DSPy같은걸 얘기하는거임? 아니면 연구토픽중 하나로 앞 턴들의 대화가 컨텍스트 윈도우 한계 때문에 일부 누락되서 이걸 최대한 일관되게 유지하는 연구토픽을 얘기하는거면 애초에 이건 응용분야가 아님.
troublecoder(troublecoder)2025-05-15 15:00
답글
@troublecoder
읽어보고 왔는데 내 말 맞는데???
ㅆㅇㅆ(124.216)2025-05-15 15:00
답글
왜 자꾸 vllm이랑 파인튜닝이랑 붙이냐? 난 파인튜닝은 ms-swift로 조지라고 한건데? 왜 그러는거임? 계속 vllm은 그만 얘기해도 된다. 파인튜닝 도메인에서
troublecoder(troublecoder)2025-05-15 15:01
답글
@troublecoder
아니 하 갑갑하네
읽어봐도 랭체인은 LLM 출력 자체를 제어 안하는데??? 출력결과는 LLM 텍스트 스트림이잖아
ㅆㅇㅆ(124.216)2025-05-15 15:01
답글
@troublecoder
안니 존나 갑갑하네
랭체인 읽어봄. 내가 잘못 알고 있었나 해서
커스텀 토크나이저 제공 안함-> 이거 파이썬에서만 됨 여전히
랭체인 역할은 LLM 서비스 호출자이지. LLM 제어기가 아닌데?
내가 말하는건 서비스 하기위한 도메인 처리를 위한 후처리는 파이썬으로밖에 안된다는건데 지금.
니가 말한 랭체인에 내가 말한 기능이 없다니까?
ㅆㅇㅆ(124.216)2025-05-15 15:02
답글
니가 말하는 출력 제어가 뭐니? 예를 들어봐. 결과에 대한 출력 형태 정의면 그냥 프롬프트엔지니어링 영역이라 전혀 상관없는거라 니가 말하는 출력 제어가 뭔지 모르겠네?
troublecoder(troublecoder)2025-05-15 15:02
답글
아니 뭘 얘기하는건지 정확하게 얘기해봐.. 랭체인이 호출제어자라고? ㅋㅋㅋ RAG나 기타 타입가드, 펑션 툴링 등 거의 대부분을 제공하는데? 정확하게 니가 말하는 용어가 뭔지 몰라서 그것부터 맞추고 시작하자.
troublecoder(troublecoder)2025-05-15 15:04
답글
@troublecoder
아 씨발 갑갑하네 출력 제어에 대한 후처리 보정과 재생성 담당이 출력제어고,이 결과 보정은 엄밀히 말해서 파이썬밖에 안된다고.
니가 말한 랭체인에 내가 말한 기능 씹 단 하나도 없는데?
ㅆㅇㅆ(124.216)2025-05-15 15:04
답글
출력보정이 뭔데? 그것부터 정의해봐. 대체 뭐길래 파이썬 밖에 안되는지 궁금하다.
troublecoder(troublecoder)2025-05-15 15:04
답글
너 혼자 쓰는 용어나 자곤같은거면 그냥 역할을 얘기해. 혼돈이 안되게
troublecoder(troublecoder)2025-05-15 15:05
답글
@troublecoder
LLM이 출력한 결과물이 기대한 형식에서 벗어났을때 후처리로 감지하고 재 생성하는건 파이썬으로만 됨
LLM 자체가 확률 앵무새라, 아무리 프롬프트로 입력해도 한계가 있어서 그걸 보정하는 역할이 출력 보정임
출력한 결과물이 양식에 맞는지 같은거
ㅆㅇㅆ(124.216)2025-05-15 15:06
답글
@ㅆㅇㅆ(124.216)
출력 제어에 대한 후처리 보정과 재생성 담당이 출력제어라고 했는데 예시를 들어서 설명해줄수있어?
llm에서 나오는 확률맵을 쓰는건 굳이 파이썬을 몰라도 됨. 그냥 출력으로 그걸 내밀면 되니까
troublecoder(troublecoder)2025-05-15 15:10
답글
@troublecoder
전혀 아님
ㅆㅇㅆ(124.216)2025-05-15 15:10
답글
@troublecoder
Huggingface에서도 RAG 구조에서 검색 결과를 그대로 LLM에 넣지 않고, 포맷 보정한다니까 저런식으로?
ㅆㅇㅆ(124.216)2025-05-15 15:11
답글
@troublecoder
공식문서 들이밀어줘도 아니라고 앵무새 소리할꺼면 뭐하러 토론을 함?
ㅆㅇㅆ(124.216)2025-05-15 15:13
답글
공식문서 일단 보고 얘기하겠음. 나 장실 좀 갔다가. 써주겠음.
troublecoder(troublecoder)2025-05-15 15:15
답글
니가 제시한 RAG는 그냥 단순히 transformer에서 제공하는 그냥 모델 하나같은데 내가 뭐 유심히 봐야해? 그냥 vllm으로 RAG모델 서빙하고 그 결과를 그대로 다시 vllm에 서빙하는 다른 llm으로 보내면 될 것 같은데?
troublecoder(troublecoder)2025-05-15 15:19
답글
@troublecoder
그 vllm 서빙하는 다른 llm으로 보내서 답변 품질 일관화 시킬때 쓰라고 있는거임;
ㅆㅇㅆ(124.216)2025-05-15 15:22
답글
@troublecoder
니가 서빙해서, LLM에 품질 일관화 보정하는게 포스트 프로세싱임.
가령 LLM 모델 훈련하고 나서 답변에 영어 단어나 다른 나라 아랍어 섞이는것도 보정하는거고
ㅆㅇㅆ(124.216)2025-05-15 15:23
답글
꼭 그 모델 쓸 필요가 있냐 싶긴한데 니가 말한 결과 일관화가 어떤 식으로 쓰이는지 알려줄래?
troublecoder(troublecoder)2025-05-15 15:23
답글
@troublecoder
아니 말했잖아. 이 모델뿐만 아니라 대부분 LLM 모델 후처리 보정에 저렇게 된다니까? 파이썬으로만 되고 현재로써는 자스 랭체인으로는 안된다고
내가 읽어보고 옴.
GPT 받아서 답변 출력할때 깨지는거 그거 수정하는것도 포스트 프로세싱이라니까?
ㅆㅇㅆ(124.216)2025-05-15 15:25
답글
답변할때 깨지는거 그래. 그거 그거 왜 파이썬만 되는거냐?
troublecoder(troublecoder)2025-05-15 15:28
답글
@troublecoder
1. 랭체인은 단순 파서의 래핑 도구임. 니가 아래 예시 가져온거 읽어봤는데,
2. 문제 감지와 복구 도구가 파이썬 생태계에만 있으니까
애초에 파이썬 위시해서 모델 만들었으니까 그거 환경이 거기있는거 맞음. OpeAI CookBook 예제 전부가 파이썬 기반임
ㅆㅇㅆ(124.216)2025-05-15 15:30
답글
@troublecoder
제대로 알고 말하고 있는데 니가 경력으로 아무리 깔아뭉개도 나는 지금 오픈 AI 쿡북이랑 다른거 공식문서 보고 말하고 있어서 나는 당당함
ㅆㅇㅆ(124.216)2025-05-15 15:31
답글
@troublecoder
1. 응답 검증 도구가 파이썬이 가장 발달함. DSpy도 결국 파이썬 기준.
2. 랭체인은 후처리 대신할 수 있지 않음. 왜? LLM 파이프라인에 없으니까
나는 정확하게 말해서 입력->출력까지의 파이프라인을 전제로 이야기하고 있는데 말장난좀 말자
ㅆㅇㅆ(124.216)2025-05-15 15:32
답글
그냥 예시를 가져와 뭔 공식문서에 어느 부분인지 얘기도 없고
troublecoder(troublecoder)2025-05-15 15:41
답글
DSPy는 진짜 웃긴게 다른 언어로도 충분히 구현 가능한건 알고 있냐? ㅋㅋㅋ DSPy가 뭐라고 난 니가 그런 테크니컬한걸 말하는건지 예시로 든것뿐이지 이게 무조건 파이썬일 필요는 없어. 니가 돈만준다면 다른 언어로 만들어줄수도 있어
troublecoder(troublecoder)2025-05-15 15:42
거기서 뭐가 틀렸는데? 난 전처리 후처리 얘기도 안 꺼냈는데?
troublecoder(troublecoder)2025-05-15 14:51
얘야. RAG가 뭐라고 생각하냐? 그냥 프롬프트에 꼳아주면 되는거임.
troublecoder(troublecoder)2025-05-15 15:11
답글
아니 실제 공식문서 쳐보면서 이야기하는데 씨발 왜 니 경험담 이야기하는데 좆 갑갑하네
ㅆㅇㅆ(124.216)2025-05-15 15:11
답글
Retrieval-Augmented Generation for Knowledge-Intensive NLP Tasks 니가 준 transformer 공식 모델에서 지원하는 RAG의 논문명임. 그냥 모델인데 이걸 그냥 서빙하면 되는건데?
troublecoder(troublecoder)2025-05-15 15:20
답글
내가 말한 RAG는 기술을 얘기한거고 니가 말한 RAG는 transformers에서 지원하는 하나의 모델에 불과함. 모델을 굳이 쓰겠다하면 난 파이썬이 아니라도 쓸수는 있어. onnx로 변경해서 다른 놈으로 가면 됨. 뭘 얘기하고 싶은거냐?
troublecoder(troublecoder)2025-05-15 15:22
답글
@troublecoder
아 진짜 계속 말장난하네
ㅆㅇㅆ(124.216)2025-05-15 15:23
답글
아니 이상한 얘기가 아니라 일반적으로 RAG라고 하면 기술을 얘기하지 논문에 구현된 모델명을 얘기하는거 아님.
troublecoder(troublecoder)2025-05-15 15:24
답글
그건 지나가는 아무나 잡고 물어봐. RAG가 뭔지. 기술인지 특정 모델인지. 거의 대부분 사람들은 전자라고 한다. 난 transformers를 존나 쓰는데 RAG라는 모델이 있는지도 오늘 너 덕분에 처음 알았어..ㅋㅋㅋ
아 왜 파인튜닝에 이 페이지 긁어온 줄 알겠다. 난 분명히 파인튜닝이 특정도메인에 맞게 미세튜닝하는거라고 했는데 왜 저 허깅페이스 페이지나 이런거 긁어오나했음. ㅆㅇㅆ 너님 ms-swift가 뭔지 모르는거같다. 내가 파인튜닝은 파이썬 알 필요없이 ms-swift 쓰면 된다고 했잖아? 근데 자꾸 이상한 얘기해서 나도 이해가 안됐는데 걔를 모르면 그럴 수 있겠다는 생각이 듬. 내가 말한건 https://github.com/modelscope/ms-swift 이고 얘는 파이썬으로 된 건 맞음. - dc App
근데 아직 llm 파이프라인이 뭔진 감이 안 오네. llm workflow면 langchain이 다 건들일 수 있는 부분이라 혹시 어떤 걸 얘기하는지 알 수 있을까? 난 싸우자는게 아님. 정말 몰라서 그래. 나도 파이썬으로 응용 아닌 부분은 조져야하는건 인정함. 근데 ㅆㅇㅆ가 응용에서 노는데 꼭 파이썬을 써야한다고해서 그게 뭘까 진짜 궁금함. 혹시 알려줄 생각 있으면 뭔가 쪽지같은게 잌ㅅ으면 날려주셈 - dc App
troublecoder(troublecoder)2025-05-15 17:26
위에 RAG모델도 대충 읽어봤는데 그냥 qa에 대해서 seq2seq모델에서 그냥 문장 생성하는것보다 정보를 주입하는 RAG기법을 도입해서 정확도를 올린 논문이고 저때는 ChatGPT자체가 없었음. 일단 논문에서 얘기하는 RAG는 기법을 얘기하는거고 저 위의 공식 페이지는 그냥 RAG라는 생성모델을 transformers라이브러리에서 쓰는 방법이 나와 있는거임 - dc App
troublecoder(troublecoder)2025-05-15 17:38
그리고 다른글에서 pydantic에 typia 꺼냈더니 동적이니 뭐라고 했는데 pydantic이 동적 타입 검증은 동의함. 파이썬은 타입이 없으니 근데 typia도 타입검증툴이고 별차이없이 pydantic따라서 https://zenn.dev/ryoppippi/articles/b0d3e17322099b 이렇게structured output을 구현해놈. 뭔 차이가 있는지는 모르겠음 - dc App
troublecoder(troublecoder)2025-05-15 17:45
그리고 json format 오류나 이런거 repair하는건 오히려 js가 라이브러리 완성도가 높을 것 같음. 왜 파이썬이 더 강력한지는 모르겠다. 오히려 llm에 난 이런 아웃풋을 원했는데 잘못됐으니 복구해달라고 요청해주면 더 잘 고쳐줄듯 - dc App
파인애뽀 튜닝 ㅇㅅㅇ
뭘 보라는 얘기임? 울지말고 얘기해봐. 니가 생각하는 파인튜닝이 뭔데?
허깅 페이스 파인튜닝 예시보면 LLM 데이터셋으로 재학습이라고 말하는데 뭔소리임
난 같은 개념이라고 얘기한적도 없는데 혼자 망상에 빠짐?
당연히 전처리,후처리,파인튜닝은 전혀 다른 문제임
그럼말을 왜 그렇게함? 말장난좀 하지마라 쳐맞을려고
내가 언제 말을 그렇게 함? 진짜 웃기네?
너가 어떻게 말했는지 보여줌? -- troublecoder .도메인이랑 서비스에 맞게 바꾸는걸 우리식 용어로는 파인튜닝이라고 한단다.. -- 라매
그거 아니라고
걍 씨발 몰랐으면 인정하면 될껄 키배 이길라고 아득바득 되네 짜증나게 uv 가르쳐줘서 좀 좋게 좋게 넘어갈랬는데
혼자 확대해석함?
니가 말한 vLLM 서빙은 한계가 명확하고, 당장 허깅 페이스에서도 저렇게 쓰라고 말한 예시 가지고 이야기중인데 니가 말한 프롬프트 엔지니어링에도 한계가 있어서 제대로 쓸려면 파이썬으로 써야한다고 이야기했는데 아니라고 우긴건 넌데?
@troublecoder 느그식 용어로는 도메인이랑 서비스에 맞게 바꾸는걸 파인튜닝이라고 한다매 ㅋㅋㅋ 그렇게 넓게 안쓴다고 파인튜닝을.
음..어디 아프냐? vllm의 서빙 한계와 파인튜닝과 전,후처리는 전혀 상관이 없어. 난 그냥 굳이 llm 붙이는데 파이썬을 쓸 필요가 없다는걸 말하는거임. 파인튜닝은 그냥 툴킷 쓰면 되고 전후처리야 앞뒷단에서 언어 맘대로 골라 쓸수있는데
@troublecoder vLLM은 일관된 컨텍스트 보장이 어렵기때문에 세부 제어를 위해서 사실상 상용한 제품화로 쓸려면 파이썬 써야한다는거고, 이거는 기업 레벨 아닌이상 당연한거임. 기업레벨에서튜닝해서 쓸수있지만 개인 개발 단위에서는 내 말이 맞는데. 이거 허깅 페이스 문서 읽고 말한거임
아프면 병원 가라.. 혼자 확대해석하고 발끈한거네
vllm의 역할은 서빙인데 일관된 컨텍스트 얘기는 왜 나오냐?
@troublecoder 뭔 소리임 대체. 니가 쓴 저 댓글은 뇌리에서 지움? 왜 자꾸 말싸움 이길라고 같잖은 말장난질이냐
@troublecoder troublecoder .도메인이랑 서비스에 맞게 바꾸는걸 우리식 용어로는 파인튜닝이라고 한단다.. 라메
일관된 컨텍스트를 유지하는건 모델 컨텍스트 사이즈의 한계가 있기 때문에 앞 턴의 내용을 어떻게 줄이냐의 이슈이고 이건 또 다른 연구 토픽중 하나임. 프롬프트 자체에 뭔가 주입해주는건 이미 파이썬 뿐만 아니라 다른 언어로도 잘 포팅되어 있어 (예.langchain)
@troublecoder 나는 그래서 그거 아니고 포스트 프로세싱 관점에서 그게 불안정하다고 이야기한건데 니가 한 말을 왜 인정 안하냐고
@troublecoder 너 존나 큰 착각하고 있는가본데, 랭체인의 핵심 기능 대다수도 파이썬으로 하고 있는건 앎? 니가 다른 언어가 되고 있다면 그 다른 언어 가져와줄래?
니가 붙인 허깅 페이스 파인튜닝의 첫문단 첫줄을 봐라. "Fine-tuning adapts a pretrained model to a specific task with a smaller specialized dataset" 이게 도메인에 맞추는게 아니면 뭘 말하는거임?
@troublecoder 나는 프롬프트 단순 조합이 쉽다 안쉽다 이런게 아님. 그거 쉽고 많이들 하고 있음. 근데 베스트 프랙티스가 아님. 근데 니가 말하는 그 랭체인 조차 주로 파이썬 위주임. 애초에 컨텍스트 최적화는 지금 파이썬에서만 되고 있음.
아..ㅆㅇㅆ야. 내가 이쪽 분야로 몇년을 밥먹고 살았는데 너보다 랭체인을 잘 안다. 그리고 보고 싶다면.
https://github.com/langchain-ai/langchainjs
를 봐라 공식이다.
@troublecoder 그게 모델 재조정이고, 니가 말한 vLLM이랑 다르다고, 뭔가 제대로 알지 못하는 느낌이고 파인튜닝 adapts는 모델 의 가중치를 바꾼다는 뜻임
컨텍스트 최적화가 뭘 말하는거냐? 정확하게 DSPy같은걸 얘기하는거임? 아니면 연구토픽중 하나로 앞 턴들의 대화가 컨텍스트 윈도우 한계 때문에 일부 누락되서 이걸 최대한 일관되게 유지하는 연구토픽을 얘기하는거면 애초에 이건 응용분야가 아님.
@troublecoder 읽어보고 왔는데 내 말 맞는데???
왜 자꾸 vllm이랑 파인튜닝이랑 붙이냐? 난 파인튜닝은 ms-swift로 조지라고 한건데? 왜 그러는거임? 계속 vllm은 그만 얘기해도 된다. 파인튜닝 도메인에서
@troublecoder 아니 하 갑갑하네 읽어봐도 랭체인은 LLM 출력 자체를 제어 안하는데??? 출력결과는 LLM 텍스트 스트림이잖아
@troublecoder 안니 존나 갑갑하네 랭체인 읽어봄. 내가 잘못 알고 있었나 해서 커스텀 토크나이저 제공 안함-> 이거 파이썬에서만 됨 여전히 랭체인 역할은 LLM 서비스 호출자이지. LLM 제어기가 아닌데? 내가 말하는건 서비스 하기위한 도메인 처리를 위한 후처리는 파이썬으로밖에 안된다는건데 지금. 니가 말한 랭체인에 내가 말한 기능이 없다니까?
니가 말하는 출력 제어가 뭐니? 예를 들어봐. 결과에 대한 출력 형태 정의면 그냥 프롬프트엔지니어링 영역이라 전혀 상관없는거라 니가 말하는 출력 제어가 뭔지 모르겠네?
아니 뭘 얘기하는건지 정확하게 얘기해봐.. 랭체인이 호출제어자라고? ㅋㅋㅋ RAG나 기타 타입가드, 펑션 툴링 등 거의 대부분을 제공하는데? 정확하게 니가 말하는 용어가 뭔지 몰라서 그것부터 맞추고 시작하자.
@troublecoder 아 씨발 갑갑하네 출력 제어에 대한 후처리 보정과 재생성 담당이 출력제어고,이 결과 보정은 엄밀히 말해서 파이썬밖에 안된다고. 니가 말한 랭체인에 내가 말한 기능 씹 단 하나도 없는데?
출력보정이 뭔데? 그것부터 정의해봐. 대체 뭐길래 파이썬 밖에 안되는지 궁금하다.
너 혼자 쓰는 용어나 자곤같은거면 그냥 역할을 얘기해. 혼돈이 안되게
@troublecoder LLM이 출력한 결과물이 기대한 형식에서 벗어났을때 후처리로 감지하고 재 생성하는건 파이썬으로만 됨 LLM 자체가 확률 앵무새라, 아무리 프롬프트로 입력해도 한계가 있어서 그걸 보정하는 역할이 출력 보정임 출력한 결과물이 양식에 맞는지 같은거
@ㅆㅇㅆ(124.216) 출력 제어에 대한 후처리 보정과 재생성 담당이 출력제어라고 했는데 예시를 들어서 설명해줄수있어?
@troublecoder
https://neptune.ai/blog/customizing-llm-output-post-processing-techniques
포스트
프로세싱 여전히 쓰는데?
난 이해가 안되는데 파이썬으로 어떻게 한다는건지 대충 알려줄 수 있음? 나 진짜 궁금하다.
@troublecoder 금칙어, 말투 일관성 이런게 출력 제어 단계임
나 후처리안된다고 한적없고. logprob같은거 쓰면 되는건데?
https://cookbook.openai.com/examples/using_logprobs
금칙어는 그럼 파이썬으로 어떻게 하는건지 알려줄수있냐? 왜 파이썬밖에 안되는지 난 모르겠다
위에 안된다고가 아니라 안한다고임
@troublecoder
https://huggingface.co/docs/transformers/v4.51.3/en/model_doc/rag#transformers.RagRetriever.postprocess_docs
이것만봐도
따로 있는데?
llm에서 나오는 확률맵을 쓰는건 굳이 파이썬을 몰라도 됨. 그냥 출력으로 그걸 내밀면 되니까
@troublecoder 전혀 아님
@troublecoder Huggingface에서도 RAG 구조에서 검색 결과를 그대로 LLM에 넣지 않고, 포맷 보정한다니까 저런식으로?
@troublecoder 공식문서 들이밀어줘도 아니라고 앵무새 소리할꺼면 뭐하러 토론을 함?
공식문서 일단 보고 얘기하겠음. 나 장실 좀 갔다가. 써주겠음.
니가 제시한 RAG는 그냥 단순히 transformer에서 제공하는 그냥 모델 하나같은데 내가 뭐 유심히 봐야해? 그냥 vllm으로 RAG모델 서빙하고 그 결과를 그대로 다시 vllm에 서빙하는 다른 llm으로 보내면 될 것 같은데?
@troublecoder 그 vllm 서빙하는 다른 llm으로 보내서 답변 품질 일관화 시킬때 쓰라고 있는거임;
@troublecoder 니가 서빙해서, LLM에 품질 일관화 보정하는게 포스트 프로세싱임. 가령 LLM 모델 훈련하고 나서 답변에 영어 단어나 다른 나라 아랍어 섞이는것도 보정하는거고
꼭 그 모델 쓸 필요가 있냐 싶긴한데 니가 말한 결과 일관화가 어떤 식으로 쓰이는지 알려줄래?
@troublecoder 아니 말했잖아. 이 모델뿐만 아니라 대부분 LLM 모델 후처리 보정에 저렇게 된다니까? 파이썬으로만 되고 현재로써는 자스 랭체인으로는 안된다고 내가 읽어보고 옴. GPT 받아서 답변 출력할때 깨지는거 그거 수정하는것도 포스트 프로세싱이라니까?
답변할때 깨지는거 그래. 그거 그거 왜 파이썬만 되는거냐?
@troublecoder 1. 랭체인은 단순 파서의 래핑 도구임. 니가 아래 예시 가져온거 읽어봤는데, 2. 문제 감지와 복구 도구가 파이썬 생태계에만 있으니까 애초에 파이썬 위시해서 모델 만들었으니까 그거 환경이 거기있는거 맞음. OpeAI CookBook 예제 전부가 파이썬 기반임
@troublecoder 제대로 알고 말하고 있는데 니가 경력으로 아무리 깔아뭉개도 나는 지금 오픈 AI 쿡북이랑 다른거 공식문서 보고 말하고 있어서 나는 당당함
@troublecoder 1. 응답 검증 도구가 파이썬이 가장 발달함. DSpy도 결국 파이썬 기준. 2. 랭체인은 후처리 대신할 수 있지 않음. 왜? LLM 파이프라인에 없으니까 나는 정확하게 말해서 입력->출력까지의 파이프라인을 전제로 이야기하고 있는데 말장난좀 말자
그냥 예시를 가져와 뭔 공식문서에 어느 부분인지 얘기도 없고
DSPy는 진짜 웃긴게 다른 언어로도 충분히 구현 가능한건 알고 있냐? ㅋㅋㅋ DSPy가 뭐라고 난 니가 그런 테크니컬한걸 말하는건지 예시로 든것뿐이지 이게 무조건 파이썬일 필요는 없어. 니가 돈만준다면 다른 언어로 만들어줄수도 있어
거기서 뭐가 틀렸는데? 난 전처리 후처리 얘기도 안 꺼냈는데?
얘야. RAG가 뭐라고 생각하냐? 그냥 프롬프트에 꼳아주면 되는거임.
아니 실제 공식문서 쳐보면서 이야기하는데 씨발 왜 니 경험담 이야기하는데 좆 갑갑하네
Retrieval-Augmented Generation for Knowledge-Intensive NLP Tasks 니가 준 transformer 공식 모델에서 지원하는 RAG의 논문명임. 그냥 모델인데 이걸 그냥 서빙하면 되는건데?
내가 말한 RAG는 기술을 얘기한거고 니가 말한 RAG는 transformers에서 지원하는 하나의 모델에 불과함. 모델을 굳이 쓰겠다하면 난 파이썬이 아니라도 쓸수는 있어. onnx로 변경해서 다른 놈으로 가면 됨. 뭘 얘기하고 싶은거냐?
@troublecoder 아 진짜 계속 말장난하네
아니 이상한 얘기가 아니라 일반적으로 RAG라고 하면 기술을 얘기하지 논문에 구현된 모델명을 얘기하는거 아님.
그건 지나가는 아무나 잡고 물어봐. RAG가 뭔지. 기술인지 특정 모델인지. 거의 대부분 사람들은 전자라고 한다. 난 transformers를 존나 쓰는데 RAG라는 모델이 있는지도 오늘 너 덕분에 처음 알았어..ㅋㅋㅋ
일단 보통 이바닥에서 출력 보정이라고 하면
https://python.langchain.com/v0.1/docs/modules/model_io/output_parsers/types/json/
이런걸 얘기하는거임.
아 왜 파인튜닝에 이 페이지 긁어온 줄 알겠다. 난 분명히 파인튜닝이 특정도메인에 맞게 미세튜닝하는거라고 했는데 왜 저 허깅페이스 페이지나 이런거 긁어오나했음. ㅆㅇㅆ 너님 ms-swift가 뭔지 모르는거같다. 내가 파인튜닝은 파이썬 알 필요없이 ms-swift 쓰면 된다고 했잖아? 근데 자꾸 이상한 얘기해서 나도 이해가 안됐는데 걔를 모르면 그럴 수 있겠다는 생각이 듬. 내가 말한건
https://github.com/modelscope/ms-swift
이고 얘는 파이썬으로 된 건 맞음. - dc App
근데 내가 파이썬을 할 필요가 없다는건
https://swift.readthedocs.io/en/latest/Instruction/Command-line-parameters.html
이런식으로 cli를 제공해줘서 굳이 알 필요가 없다는거임. 어째튼 이렇게 툴킷으로 잘 만들어놨으니 몰랐다면 파인튜닝하는데 잘 쓰셔 - dc App
근데 아직 llm 파이프라인이 뭔진 감이 안 오네. llm workflow면 langchain이 다 건들일 수 있는 부분이라 혹시 어떤 걸 얘기하는지 알 수 있을까? 난 싸우자는게 아님. 정말 몰라서 그래. 나도 파이썬으로 응용 아닌 부분은 조져야하는건 인정함. 근데 ㅆㅇㅆ가 응용에서 노는데 꼭 파이썬을 써야한다고해서 그게 뭘까 진짜 궁금함. 혹시 알려줄 생각 있으면 뭔가 쪽지같은게 잌ㅅ으면 날려주셈 - dc App
위에 RAG모델도 대충 읽어봤는데 그냥 qa에 대해서 seq2seq모델에서 그냥 문장 생성하는것보다 정보를 주입하는 RAG기법을 도입해서 정확도를 올린 논문이고 저때는 ChatGPT자체가 없었음. 일단 논문에서 얘기하는 RAG는 기법을 얘기하는거고 저 위의 공식 페이지는 그냥 RAG라는 생성모델을 transformers라이브러리에서 쓰는 방법이 나와 있는거임 - dc App
그리고 다른글에서 pydantic에 typia 꺼냈더니 동적이니 뭐라고 했는데 pydantic이 동적 타입 검증은 동의함. 파이썬은 타입이 없으니 근데 typia도 타입검증툴이고 별차이없이 pydantic따라서
https://zenn.dev/ryoppippi/articles/b0d3e17322099b
이렇게structured output을 구현해놈. 뭔 차이가 있는지는 모르겠음 - dc App
그리고 json format 오류나 이런거 repair하는건 오히려 js가 라이브러리 완성도가 높을 것 같음. 왜 파이썬이 더 강력한지는 모르겠다. 오히려 llm에 난 이런 아웃풋을 원했는데 잘못됐으니 복구해달라고 요청해주면 더 잘 고쳐줄듯 - dc App
어때튼 토론할 생각이면 쪽지 주셈 - dc App