StoryDiffusion: ์ฅ๊ฑฐ๋ฆฌ ์ด๋ฏธ์ง ๋ฐ ๋น๋์ค ์์ฑ์ ์ํ ์ผ๊ด๋ Self-Attention์ ๊ณต์ ๊ตฌํ์
๋๋ค.
? ์ฃผ์ ๊ธฐ๋ฅ:
StoryDiffusion์ ์ผ๊ด๋ ์ด๋ฏธ์ง์ ๋น๋์ค๋ฅผ ์์ฑํ์ฌ ๋ง๋ฒ ๊ฐ์ ์ด์ผ๊ธฐ๋ฅผ ๋ง๋ค ์ ์์ต๋๋ค. ์ฐ๋ฆฌ์ ์์
์ ์ฃผ๋ก ๋ ๋ถ๋ถ์ผ๋ก ๊ตฌ์ฑ๋ฉ๋๋ค:
1. ์ฅ๊ฑฐ๋ฆฌ ์ํ์ค์ ๊ฑธ์ณ ์บ๋ฆญํฐ ์ผ๊ด์ฑ ์๋ ์ด๋ฏธ์ง ์์ฑ์ ์ํ ์ผ๊ด๋ self-attention์
๋๋ค. ์ด๋ hot-pluggableํ๋ฉฐ ๋ชจ๋ SD1.5 ๋ฐ SDXL ๊ธฐ๋ฐ ์ด๋ฏธ์ง diffusion ๋ชจ๋ธ๊ณผ ํธํ๋ฉ๋๋ค. ํ์ฌ ๊ตฌํ์์๋ ์ฌ์ฉ์๊ฐ ์ผ๊ด๋ self-attention ๋ชจ๋์ ๋ํด ์ต์ 3๊ฐ์ ํ
์คํธ prompt๋ฅผ ์ ๊ณตํด์ผ ํฉ๋๋ค. ๋ ๋์ ๋ ์ด์์ ๋ฐฐ์น๋ฅผ ์ํด ์ต์ 5 - 6๊ฐ์ ํ
์คํธ prompt๋ฅผ ๊ถ์ฅํฉ๋๋ค.
2. ์ฅ๊ฑฐ๋ฆฌ ๋น๋์ค ์์ฑ์ ์ํ motion predictor๋ก, ์์ถ๋ ์ด๋ฏธ์ง ์๋ฏธ ๊ณต๊ฐ์์ Condition Images ์ฌ์ด์ motion์ ์์ธกํ์ฌ ๋ ํฐ motion ์์ธก์ ๋ฌ์ฑํฉ๋๋ค.
OpenAI Sora์๋ ๋ฌ๋ฆฌ ์คํ์์ค๋ก ๊ณต๊ฐ๋์ ๋งค์ฐ ์ฅ์ ์ด ์์
ํ์ฌ๋ ์ฝ๋ฏน ์์ฑ ์์ค์ฝ๋๊น์ง๋ง ๊ณต๊ฐ๋ผ ์๊ณ ย
๊ณง ๋น๋์ค ์์ฑ ๋ชจ๋ธ ์์ค์ฝ๋ ๋ฐ pretrain๋ ๋ชจ๋ธ ๊ณต๊ฐ ์์ ์ธ๋ฏ
๊ธฐ์กด SD์ ํธํ๋๋ค ํ๋ ์ข๋ค
์คํ์์ค ๊ตฟ
์์ai ๋ง๋ ์ง ์ผ๋ง๋๋ค๊ณ ์๋ฆฌ๋ฐ๋๊น์ง ์๋ค
๊ณง ํน์ง : ์๋
์๋ฅด์ฟค์๋ฐฌใ ใ ใ ใ ใ ใ ใ ใ ใ ๋ณด์๋ง์ ํฐ์ง
์ผ์ธ ๋ค ์ ๊ฑธ๋ก ๋ง๋ค๊ฒ ๋ค ใ ใ
์ค ใ ใ ใ
๋ฏธ์ณค๊ตฐ
๋ฅด์ฟค ๋ญ์ ใ ใ
ํธ์น์ด
image to video๋ ๋๋๋ณธ๋ฐ? ๊ฒ๋ค๊ฐ sdํธํ ใทใท