안녕하세요

딥러닝 개초보입니다. 전공도 건설계열이라 완전 무지한인데

주제는 말씀드리기가 조금 그렇고 input으로 3채널 이미지 2장과 1채널(binary) 이미지 1장을 가지고

강화학습 알고리즘(PPO)을 좀 구성하고 있는데요..

Policy Network를 구성하는 과정에서 혹시 고수님들은 여러 input들을 어떻게 합쳐서 넣을지, 레이어들을 어떻게 구성할지

 Feature Extractor Network 에 있어서 Dinov3 같이 pretrain된 모델을 사용한다 하면 어떤 걸 좀 사용해볼지 이런 걸 

어떤 생각을 가지고 설계를 하시는지 궁금하네요..

(여기 이런 레이어를 구성하면 학습이 잘 될 거야 <- 이런 사고를 할 때 어떤 근거를 생각하시는지..)