GLM 4.7 FLASH 써봤는데, 실성능은 우수한데,
이게 한글 잘 못알아먹는게 생각보다 크네, 알긴아는데 한글프롬프트 효율이 너무 떨어짐
(내가 reap 23B 압축모델 써서 그런걸수도 있음. LMstudio에서 돌리니 상태 이상하더라고)
그렇다고 젬마3 쓰느니 gpt-oss 씀
내생각에는 지금 몰트북 히트하면 한 몇달 내로
이쪽 니즈에 맞춘 제품도 나오지않을까 싶음 어짜피 30B이하 스몰모델 최적화라 사실 뭐 스터디비용이 존나 높을거같진않은데
대신 젬플대비해서도 빡통이니, 계획은 모두 외부에서 opus로 정하고, 할수있는일만 내부에서 진행하는걸로 가야할듯.
나는 내 백업데이터 ocr 할 자료 정리 + 파일정리 + 파일 계층화 + 태그 시키는중 어짜피 정교화 안되는건 따로 분류만 되면 되니까 이런걸 잘하더라고 그렇다고 이거 다 젬플 api에 돌리면 api비용 존나나옴
한글은 젬마가 낫긴 할걸? 일을 못해서 그렇지..
Oss가 나온지 좀 됐는데도 아직도 좋나보네
툴 사용을 압도적으로 잘함
14~30B 모델이 요즘 잘 안나오는것도 있는거같음 성능자체는 glm-4.7 flash가 다음세대라 말할정도로 많이 높긴함
@글쓴 ㅇㅇ(59.6) ㅇㅎ 이번 몰트봇을 계기로 프론티어급 20b모델 많이 나왔음 좋겠네 ㅋㅋ
실사용은 oss가 가장 좋은듯 20b 120은 저건 개인이 못쓰고, 젬마도 좋음 근데 그냥 로컬은 그냥 역체감만 된다 그냥 대기업꺼 써
glm 4.7 flash가 툴 사용은 좋다곤하는데...한글은 또 잘 못한다는 평도 있고요. 여튼 32gb ram이하에선 gpt oss 20b가 레퍼런스인듯해요. - dc App
빨리 젬마4가 나와야 하는데 구글은 뭐하냐! Qwen 3.5라도 빨리 나왔으면 좋겠다.
앤트로픽에서 하이쿠급 로컬모델 따로 좀 내주면 진짜 잘쓸거같은데 안내줌.. 후
오픈 라우터에 120b 프리 모델이 있는데 그거 한번 써보셈. api 청구 안됨
좀쓰다보면 rate limit 걸립니다. 물론 유료로 써도 저렴하긴합니다만 - dc App