LTX surphul int8 convrot 양자화
정확히는
LTX surphul int8 convrot + condsafe72 distill lora 양자화인데
모델만 꼴랑 양자화하는건 속도면에서 의미가 없음
LTX sulphur int8 convrot + condsafe72@0.4
LTX sulphur int8 convrot + condsafe72@0.5
LTX sulphur int8 convrot + condsafe72@0.6
LTX sulphur int8 convrot + condsafe72@0.7
이 4종류를 해놓고 잘 생각해봐야할듯. 4개 하면 용량은 거의 100GB임
양자화는 CTQ를 썼더니 변환속도도 엄청 느리지만. 추론속도도 느리고. 이상해서
지금은 그냥 W8A8 노드로 뚝딱 만드는 게 무난함 . 어차피 어떻게 해도 FP8보다 품질 좋음
GPT와 GROK의 정리
- 기반 모델: LTX 2.3
- 목표: 검열이 적고(local-first), 프롬프트 자유도가 높은 사실적인 영상 생성
- 배포 형태: Hugging Face에서 모델 가중치(BF16, FP8 Mixed), Distill LoRA, ComfyUI 워크플로우 등을 함께 공개
-
지원 기능
- Text-to-Video
- Image-to-Video
- ComfyUI 워크플로우
- 로컬 Prompt Enhancer(Qwen 기반)
- 약 12.5만 개의 10초 영상 데이터를 이용해 추가 학습했다고 개발 측은 설명합니다.
기존 상용 모델보다 프롬프트 제한이 적어 다양한 스타일과 장면을 생성하기 쉽다는 평가가 많습니다.
2. 현실적인 영상훈련 과정에서 2D 애니메이션을 대부분 제외하고 실제 영상 위주로 학습하여 현실적인 인물과 움직임을 목표로 했습니다.
3. 로컬 실행 가능Runway나 Sora처럼 클라우드 서비스가 아니라 GPU에서 직접 실행할 수 있어 개인정보 보호와 비용 면에서 장점이 있습니다.
4. LTX 생태계와 호환기존 LTX 2.3용 ComfyUI 워크플로우를 거의 그대로 사용할 수 있습니다.
5. FP8 Mixed 제공
VRAM이 부족한 환경에서도 비교적 쉽게 사용할 수 있는 FP8 Mixed 모델을 제공합니다
LTX 2.3 워크플로우에 드롭인(drop-in)으로 바로 교체해서 사용할 수 있도록 설계되었습니다.
장점| 장점 | 설명 | 비고 |
|---|---|---|
| 완전 Uncensored | 성인/NSFW/제한 없는 콘텐츠 생성이 자유로움 | 커뮤니티에서 가장 크게 주목받는 이유 |
| 모션 품질 향상 | Base LTX 2.3 대비 주체 가장자리 깜빡임 감소, cinematic motion 강화, 일관성 향상 | 특히 빠른 움직임이나 패닝 샷에서 두드러짐 |
| 드롭인 호환성 | 기존 LTX 2.3 ComfyUI 워크플로우에 그대로 교체 가능 | 추가 노드나 컨버터 불필요 |
| 다양한 양자화 지원 | FP8, GGUF(Q8~Q3) 버전 존재 → VRAM 절감 | 16~32GB 추천, 8GB도 실험적으로 가능 |
| 번들 도구 | Prompt Enhancer + Distill LoRA + 공식 워크플로우 제공 | 바로 시작하기 좋음 |
| 리얼리즘 중심 | 2D/애니메이션 데이터 제외 훈련으로 해부학적 안정성 상대적으로 좋음 | Base 모델 대비 |
| 단점 | 설명 | 비고 |
|---|---|---|
| 과도한 파인튠 부작용 ("over-sulphur") | Ghost anatomy(유령 같은 신체 왜곡), 과도한 explicitness, subtitles(자막) 현상 등 | 10Eros 같은 후속 모델에서 보완 시도 중 |
| Distilled 버전 품질 저하 | Distill LoRA 사용 시 anatomical/motion 아티팩트 증가 | 속도와 품질 트레이드오프 |
| 프롬프트 민감도 | 복잡한 프롬프트에서 adherence가 base 대비 떨어질 수 있음 | 상세하고 엄격한 프롬프트 필요 |
| VRAM/리소스 부담 | Full BF16은 매우 큼. 고해상도·장시간 영상에서는 메모리 관리 중요 | Quantized 버전이라도 8GB는 제한적 |
| 문서화 미흡 | 릴리스 초기 setup/training docs가 불완전 | 커뮤니티 의존도가 높음 |
| 공식 지원 없음 | Lightricks 공식 모델이 아닌 커뮤니티 파인튠 | 업데이트·안정성 면에서 공식 모델 대비 불리 |
- Base LTX 2.3: 더 안정적이고 공식 지원이 좋음. 특정 상황에서 더 predictable.
- Sulphur 2: Uncensored + 모션/표현력에서 우위. 하지만 일부 아티팩트(ghost anatomy 등)와 distilled 사용 시 품질 저하 리스크 있음.
GPT나GROK도 자기가 알고 말하는게 아니라 그냥 검색후 정리해서 보여주는것임 환각도 어느 정도 섞이고
Surphur 모델을 쓰면 립싱크도 잘 안 하거나 그런 증상은있음
그래서 실제로는 Surphur 768rank lora를 희석해서 쓰기도 하고 condsafe distill lora도 사용함
이걸 전부 int8로 가중치 셋팅해서 pre-lora로 합쳐야하는게 문제인데
처음에만 잘 고생하면 어느 정도 답이 나오기 땜에
해줘해줘 할때 수백번 실험해보고 뽑아서 나혼자 쓰는게 이득임
원래 그렇게 해온 사람들은 그렇게 알아서 함
돈도 각자 알아서 잘 벌고
쟤 소아때 엄청
왜 유동에게서 익숙한 향기가 나냐.. 고닉이었음?
로컬단도 작업탭으로 좀;
이걸 알아듣는 사람 여기 한명이라도 있을까 싶다 아카에 올리던가 - dc App
wan을 int8로 해줘