해당 pdf들을 모두 상세히 설명해줘. 너가 용량의 한계를 느껴진다면 여러 섹터로 나눠서 얘기해줘도 좋아 길어도 문제없어 다른 소스 참고하지말고, 해당 PDF들을 대학생에게 말하듯이 교수처럼 빠지는 내용없이 상세히 설명해줘 그리고, 중요하다고 추론되는 내용은 강조표시를 꼭 남겨줘. 퍼펙트하게 설명해주길 바래. 난 이와 관련해서 아주 상세한 퀴즈를 풀어야하거든 근데 너 계속 필요한 예시를 빼먹는데, 전부 설명해야해 똑바로 일해.
이런식으로 짜내고 있는데 ㅋㅋㅋㅋ 더 좋은 방법이 있을까 싶어서
요약시킬 때 좋은 프롬프트를 어떻게 짜면 되는지도 물어봐봐 - dc App
그걸 직접 물어보면 알려줘? ㄷㄷㄷ 대단하네
유료면 1.요약 전 글 / 2. 니 요약프롬 / 3. 요약 결과물 먼저 넣고 분석시킨 다음 프롬프트 짜달라 그래봐 - dc App
퍼플렉 R1 쓰고 있고 chatgpt 20불짜리가 더 성능이 좋다면 그걸로 갈아탈 용의가 있어. 릴리즈ai가 참 요약을 잘하던데 그정도 바라긴 함
1. 일단 너는 요약을 하고 싶다면서 프롬프트는 상세히 설명해달라고 하는데.. 니가 뭘 원하는지부터 먼저 판단해봐. 2. PDF 길면은.. 요약은 괜찮을건데, 모든 페이지 상세설명? 그건 안됨. 다 쪼개서 물어봐라. 3. 프롬프트 자체는 지금 처럼 막 쓴 프롬프트를 가지고 ai한테 그대로 질문하면 되잖아.
정확히 원하는 건 글쓴이가 말하는 중요 포인트별로 정리해서, 비전공 대학생에게 말하듯이 쉽게 설명해달라는 거였어 근데, 상세설명이라는 걸 안붙히니까 나같은 경우엔 애널 보고서에서 유의미한 시그널(상승 하락 시그널)을 찾는 게 중요한데, 꼭 포인트들을 놓치더라고
서머리는 지금까지 알려진 방법 중 가장 효율적인 것이 청킹임...
응..? 무슨 말이야?
일정 토큰 개수와 오버랩 청크 개수를 정하고 그 단위로 청크를 나눠서 요약을 시키고 다시 요약문을 합쳐서 다시 같은 방법으로 원하는 토큰 개수 나올때까지 반복.
이유는 모르겠지만 LLM 모델들 모두가 장문 요약 과제에서 이상하게 어텐션을 잃어버림.
그래서 이걸 막기 위해 토큰을 줄이고 병렬화해서 작업 속도를 높이는 기법으로 나온 것이 청킹
내가 겪었던 현상이랑 똑같음 ; 오버랩 청크 개수랑 일정 토큰 개수 정하는 건 어떻게 할 수 있는거야? chatgpt에서만 구동 가능한건가