BE <-> FE 간 코드를 다 봐야되고 로직이 복잡해지니까 결국 실수가 많이 발생한다.


코드 작성기로 소넷 4.5보다 쓸만해진건 맞는데, 얘한테 지휘권을 줄 수는 없네.


이 부분은 gpt-5.1 이 최고 인듯.




아, 그리고 의외로 gpt-5.1 보다 codex-max xhigh 쪽이 날카롭게 짚는 부분이 있음.


gpt-5.1 이 약간 에이 좋은게 좋은거~ 느낌이라면 (즉, 크리티컬 하지 않으면 괜찮다함, 나중에 리팩터링하시죠~ 느낌. 근데 인지는 하고 있음.)


codex-max 같은 경우에는 칼날같이 찌르는 성향이니 참고.


단, 넓게 보는건 gpt-5.1 이야.