*컨텍스트 캐싱 가이드*
" style="box-sizing: inherit; margin: 16px 0px 0px; padding: 0px; color: rgb(32, 33, 36); font-family: Roboto, "Noto Sans", "Noto Sans JP", "Noto Sans KR", "Noto Naskh Arabic", "Noto Sans Thai", "Noto Sans Hebrew", "Noto Sans Bengali", sans-serif; font-size: 16px;">

Gemini API 컨텍스트 캐싱 기능은 입력 토큰 수가 많은 반복 콘텐츠가 포함된 요청의 비용을 절감하도록 설계되었습니다.

컨텍스트 캐싱을 사용해야 하는 경우

컨텍스트 캐싱은 특히 짧은 요청에서 상당한 초기 컨텍스트를 반복적으로 참조하는 시나리오 (광범위 한 이야기 전개가 필요한 소설, 캐릭터RP 유저들) 에 적합합니다. 다음과 같은 사용 사례에 컨텍스트 캐싱을 사용하는 것이 좋습니다.

  • 광범위한 시스템 지침을 제공하는 챗봇
  • 긴 동영상 파일의 반복적인 분석 (비디오 비전)
  • 대규모 문서 세트에 대한 반복 쿼리
  • 빈번한 코드 저장소 분석 또는 버그 수정
캐싱을 통한 비용 효율성

컨텍스트 캐싱은 전반적인 운영 비용을 절감하도록 설계된 유료 기능입니다. 결제는 다음 요소를 기준으로 합니다.

  1. 캐시 토큰 수: 캐시된 입력 토큰 수. 이후 프롬프트에 포함되는 경우 더 낮은 요율로 청구됩니다.
  2. 저장 기간: 캐시된 토큰이 저장된 시간이며, 시간 단위로 청구됩니다.
  3. 기타 요인: 캐시되지 않은 입력 토큰 및 출력 토큰 등의 기타 요금이 적용됩니다.

최신 가격 세부정보는 Gemini API 가격 책정 페이지를 참조하세요. 토큰을 계산하는 방법은 토큰을 참조하세요.

곧 컨텍스트 캐싱 시작하기

기술 문서 및 SDK 지원과 함께 컨텍스트 캐싱이 곧 출시될 예정입니다.


12일 업뎃 저 기술인거같은뎅


API 관련 문서에 동봉 되어있는걸로 보아


API 에 묶어서 같이 나올 듯


GPT - 5 와 제미니 - ULTRA 는 [텍스트+이미지+오디오] + [비디오 비전] 이 결합되어있는 단일 신경망일 확률이 높음