무엇이 바뀌었나요?
- Llama 3.2 Vision(즉, Mllama) 아키텍처 지원
- 새로운 세대 NVIDIA 그래픽 카드(예: RTX 40 시리즈)의 성능 향상
- 이제 비전 모델에 대한 후속 요청을 보내는 속도가 훨씬 빨라졌습니다.
- 정지 시퀀스가 올바르게 감지되지 않는 문제가 해결되었습니다.
- 이제 Ollama는 "ollama create my-model"을 실행할때 Modelfile 없이 Safetensors에서 모델을 가져올 수 있습니다.
- Windows에서 출력을 파일에 리디렉션하면 잘못된 문자가 쓰여지는 문제가 해결되었습니다.
- 잘못된 모델 데이터로 인해 Ollama에서 오류가 발생하는 문제가 해결되었습니다.
오 라마비전 gguf 돌아가나?