안녕하세요
딥러닝 개초보입니다. 전공도 건설계열이라 완전 무지한인데
주제는 말씀드리기가 조금 그렇고 input으로 3채널 이미지 2장과 1채널(binary) 이미지 1장을 가지고
강화학습 알고리즘(PPO)을 좀 구성하고 있는데요..
Policy Network를 구성하는 과정에서 혹시 고수님들은 여러 input들을 어떻게 합쳐서 넣을지, 레이어들을 어떻게 구성할지
Feature Extractor Network 에 있어서 Dinov3 같이 pretrain된 모델을 사용한다 하면 어떤 걸 좀 사용해볼지 이런 걸
어떤 생각을 가지고 설계를 하시는지 궁금하네요..
(여기 이런 레이어를 구성하면 학습이 잘 될 거야 <- 이런 사고를 할 때 어떤 근거를 생각하시는지..)
2장이랑 1장은 뭐임 데이터가 고작 그거 밖에 없다는 거임?
pretrained 말곤 답 없다 ㄱㄱ
입력값이 3장이란거 같은 느낌
저걸로 뭘 하고 싶은지 얘기를 해야 강화학습을 어떻게 적용할지 얘기를 해주지 애초에 주어진 정보만으론 강화학습이 맞는 방법인지조차 모름
강화학습 전문가를 고용하세요