씹덕캐릭터 챗봇 기억력 증강용으로 써보려고 스토리 데이터 긁어서 집어넣고 구축해봤음 무료인거 치고 생각보다 많이 좋은듯? 무지성 컨트롤 F 수준이 아니라, 어느정도 문맥을 알아먹고 가장 관련성이 높은 부분을 자동으로 발췌해줌 시간은 5초정도 걸리고
ㅇㅎ. 모델 성능은 어떻노?
한국어 데이터만 있어서 en모델들은 안썻도, bgem3랑 embedinggemma 두가지 써봤음. embedinggemma 이건 한국어 기준에서 폐급이더라.... 구글이라 기대했는데 많이 처참했음
@<b>유동닉 ㅋㅋㅋ 맞노. 찾아보니까 언어쪽 특화모델인 것 같노
EmbeddingGemma는 온디바이스 사용 사례에 최적화 된 LLM 이라노
ㅇㅎ. AutoRAG는 RAG파이프라인 최적화라고 하노. 신기하노
성능좋은 RAG를 진짜 딸깍 몇번 수준으로 구축하는것도 개쩔지만, Workers에 코드 한줄로 간단히 통합되는게 진짜 최고임