그냥 추론을 최소화시킨거임? api로 가져온거에서 추론을 줄여봤자 많이 못줄이지 않음? 나도 thinking budget 같은거 확 줄여놓고 쓰는데 적어도 10초임 걔내들은 2초만에 나오잖아. 원리가 뭔지 궁금해. 단순히 구글과 계약해서 개별 서버를 써서 그런건가? 그건 아닐 것같은데
[일반] ai챗플랫폼에서 제미니는 응답속도가 존나빠르던데
익명(cement0706)
2025-09-29 08:50
추천 0
댓글 1
다른 게시글
-
결국 오늘도 출근을 하였구나... 다음주 월요일에는 노동해방이 오기를.. [1][일반] Varian Wr..(hanjanthe) | 25.09.29추천 0
-
웹사이트명:무네스코 뭇집리스트[일반] moo토낑10(59.24) | 25.09.29추천 0
-
일상혁신의 중심은 스마트 글래스겠지?[일반] 익명(49.164) | 25.09.29추천 0
-
요즘 씨발왜케 소식없음? 개발자 단체휴가감? [3][일반] 익명(39.120) | 25.09.29추천 0
-
완몰가는 아직 까마득한 기술인가 [3][일반] 익명(112.171) | 25.09.29추천 0
-
CODEX CLI로 제미니 API 쓰면 좋음? [1][일반] 익명(115.138) | 25.09.29추천 0
-
제대로된 에이전트만 나와도 모든게 뒤바뀐다...이기야... [3][일반] 익명(tragedy7204) | 25.09.29추천 0
-
ai 구독 공유해서 저렴하게 사는거말야 [1][일반] 익명(tube5335) | 25.09.29추천 0
-
잠에 들기 전후의 나는 의식의 연속성이 없는데 [15][일반] 익명(49.164) | 25.09.29추천 0
-
이번주도 다들 파이팅하십쇼 [2][일반] 트라야누스(59.9) | 25.09.29추천 4
개인 의견: 2초만에 나오는거면 추론보다는 gemini-2.5-flash-lite같은 경량화 모델을 쓰거나 자체 경량화 모델을 쓴거라고 생각함. 개별 서버를 쓴다고 그만큼 속도가 나올 것 같지는 않고, 별도 추론 칩을 쓸 수도 있긴 한데 가능성은 거의 없다고 봄.