LTX surphul int8 convrot 양자화




정확히는 


LTX surphul int8 convrot + condsafe72 distill lora 양자화인데

모델만 꼴랑 양자화하는건 속도면에서 의미가 없음


LTX sulphur int8 convrot + condsafe72@0.4
LTX sulphur int8 convrot + condsafe72@0.5
LTX sulphur int8 convrot + condsafe72@0.6

LTX sulphur int8 convrot + condsafe72@0.7

이 4종류를 해놓고 잘 생각해봐야할듯. 4개 하면 용량은 거의 100GB임


양자화는 CTQ를 썼더니 변환속도도 엄청 느리지만.  추론속도도 느리고. 이상해서


지금은 그냥 W8A8 노드로 뚝딱 만드는 게 무난함 . 어차피  어떻게 해도 FP8보다 품질 좋음





GPT와  GROK의 정리


개발 개요
  • 기반 모델: LTX 2.3
  • 목표: 검열이 적고(local-first), 프롬프트 자유도가 높은 사실적인 영상 생성
  • 배포 형태: Hugging Face에서 모델 가중치(BF16, FP8 Mixed), Distill LoRA, ComfyUI 워크플로우 등을 함께 공개
  • 지원 기능
    • Text-to-Video
    • Image-to-Video
    • ComfyUI 워크플로우
    • 로컬 Prompt Enhancer(Qwen 기반)
  • 12.5만 개의 10초 영상 데이터를 이용해 추가 학습했다고 개발 측은 설명합니다.
장점1. 프롬프트 자유도가 높음

기존 상용 모델보다 프롬프트 제한이 적어 다양한 스타일과 장면을 생성하기 쉽다는 평가가 많습니다.

2. 현실적인 영상

훈련 과정에서 2D 애니메이션을 대부분 제외하고 실제 영상 위주로 학습하여 현실적인 인물과 움직임을 목표로 했습니다.

3. 로컬 실행 가능

Runway나 Sora처럼 클라우드 서비스가 아니라 GPU에서 직접 실행할 수 있어 개인정보 보호와 비용 면에서 장점이 있습니다.

4. LTX 생태계와 호환

기존 LTX 2.3용 ComfyUI 워크플로우를 거의 그대로 사용할 수 있습니다.

5. FP8 Mixed 제공

VRAM이 부족한 환경에서도 비교적 쉽게 사용할 수 있는 FP8 Mixed 모델을 제공합니다





LTX 2.3 워크플로우에 드롭인(drop-in)으로 바로 교체해서 사용할 수 있도록 설계되었습니다.

장점
장점설명비고
완전 Uncensored성인/NSFW/제한 없는 콘텐츠 생성이 자유로움커뮤니티에서 가장 크게 주목받는 이유
모션 품질 향상Base LTX 2.3 대비 주체 가장자리 깜빡임 감소, cinematic motion 강화, 일관성 향상특히 빠른 움직임이나 패닝 샷에서 두드러짐
드롭인 호환성기존 LTX 2.3 ComfyUI 워크플로우에 그대로 교체 가능추가 노드나 컨버터 불필요
다양한 양자화 지원FP8, GGUF(Q8~Q3) 버전 존재 → VRAM 절감16~32GB 추천, 8GB도 실험적으로 가능
번들 도구Prompt Enhancer + Distill LoRA + 공식 워크플로우 제공바로 시작하기 좋음
리얼리즘 중심2D/애니메이션 데이터 제외 훈련으로 해부학적 안정성 상대적으로 좋음Base 모델 대비
단점
단점설명비고
과도한 파인튠 부작용 ("over-sulphur")Ghost anatomy(유령 같은 신체 왜곡), 과도한 explicitness, subtitles(자막) 현상 등10Eros 같은 후속 모델에서 보완 시도 중
Distilled 버전 품질 저하Distill LoRA 사용 시 anatomical/motion 아티팩트 증가속도와 품질 트레이드오프
프롬프트 민감도복잡한 프롬프트에서 adherence가 base 대비 떨어질 수 있음상세하고 엄격한 프롬프트 필요
VRAM/리소스 부담Full BF16은 매우 큼. 고해상도·장시간 영상에서는 메모리 관리 중요Quantized 버전이라도 8GB는 제한적
문서화 미흡릴리스 초기 setup/training docs가 불완전커뮤니티 의존도가 높음
공식 지원 없음Lightricks 공식 모델이 아닌 커뮤니티 파인튠업데이트·안정성 면에서 공식 모델 대비 불리
요약 비교 (Base LTX 2.3 vs Sulphur 2)

  • Base LTX 2.3: 더 안정적이고 공식 지원이 좋음. 특정 상황에서 더 predictable.
  • Sulphur 2: Uncensored + 모션/표현력에서 우위. 하지만 일부 아티팩트(ghost anatomy 등)와 distilled 사용 시 품질 저하 리스크 있음.










GPT나GROK도 자기가 알고 말하는게 아니라 그냥 검색후 정리해서 보여주는것임 환각도 어느 정도 섞이고 


Surphur 모델을 쓰면 립싱크도 잘 안 하거나 그런 증상은있음

그래서 실제로는 Surphur 768rank lora를 희석해서 쓰기도 하고 condsafe distill lora도 사용함

이걸 전부 int8로 가중치 셋팅해서 pre-lora로 합쳐야하는게 문제인데

처음에만 잘 고생하면  어느 정도 답이 나오기 땜에


해줘해줘 할때 수백번 실험해보고 뽑아서 나혼자 쓰는게 이득임


원래 그렇게 해온 사람들은 그렇게 알아서 함


돈도  각자 알아서 잘 벌고