로지스틱 회귀
컨벡스 최적화
체인룰
이거 세개면 된다
활성함수로 sigmoid를 썼을때부터 배우므로 로지스틱회귀
지식이 필요하고, ReLU 언급하면서 최적화 문제가 Non convex가 되는데도 gradient descent를 쓰는 이유를 알아야하고, 학습 핵심 알고리즘 역전파는 체인룰 그이상도 그 이하도 아니다