7fe98370b78161f336efe9b741d3716e5cfa3e1bcbaf6af5ae1f355ab524d6571bad93fc5c02773d56bbdfec5fb1b4d0960d516718336396f1f3aa5cd74b22c470343af3a5d4d8ad0e6e

그냥 추론을 최소화시킨거임? api로 가져온거에서 추론을 줄여봤자 많이 못줄이지 않음? 나도 thinking budget 같은거 확 줄여놓고 쓰는데 적어도 10초임 걔내들은 2초만에 나오잖아. 원리가 뭔지 궁금해. 단순히 구글과 계약해서 개별 서버를 써서 그런건가? 그건 아닐 것같은데