모든 AI 모델은 최신모델+Thinking 모드가 기본



선요약)

- 최신 검색: GPT, 구글 AI모드(잼3프로 웹검색)

- 최신 동향: Grok(전문가/일반 의견이나 정서)


- 유튭, 사진/문서 OCR, 동영상이나 이미지 맥락파악: Gemini

- PDF 대량 처리: Gemini


- 심층연구: Gemini 3 pro 프리뷰 떼지기 전에는 GPT나 Claude. Grok은 심층연구 돌려도 Thinking이랑 검색량만 차이남



1. 최신 검색

GPT / Grok > Sonnet/Opus > Gemini


- GPT는 서버시간=현재시간이 사후/강화학습에 명시되었다고 함

- GPT는 교차검증도 사후학습에서 강조된다고 함


- Grok은 정서/의견 등을 알기 좋음. X에 대한 API 접근은 Grok을 제외하고는 모두 차단되어 있음. 일반뉴스도 나쁘지 않은데 "오늘 최신뉴스 가운데 중요한 순으로 보여줘"라고 하면 GPT는 왜 중요한지도 알려주는데, Grok은 이게 중요함 띡 이런 느낌


- Sonnet/Opus는 좋은데 평범한 검색. 연구를 돌리면 아주 좋음. 사실 학술같은데 쓰이는 보수적인 검색 정책으로 접근하면 제일 좋은데 5시간/주간 사용량 제한이 너무 적음


- Gemini는 Temporal Paradox(시간역설)에 걸리면 최하위, 안 걸리면 최상위

- 그냥 구글 AI모드 쓰면 그게 구글검색엔진 쓰는 제미니 3 프로임






2. 2024년 12월까지의 내용도 중요한 학술/개념적 검색

GPT=Gemini=Sonnet/Opus > Grok


- 공부하는 거 아니고 확인하는 거면 아무거나 쓰셈

- 공부하는 거면 Gemini. Gemini가 시각화가 좋음. 특이점갤 가서 자료실 - Ailey & Bailey 젬스 쓰면 좋음



3. 유튭, 문서/사진 OCR, 연속이미지 맥락 파악, 아무거나 많이 먹여보기

Gemini > 그외


- 잼황



4. (안 써본) 영상


- 일반영상: GPT의 Sora2

- 야옹영상: Grok



5. (안 써본) 코딩


- 클로드 코드랑 GPT 코덱스 같이 쓰면서 교차검증한다고 함

- 코딩 분야마다 클로드 좋다 GPT 좋다가 갈림



6. 심층연구


- GPT: 안정적인 맛+다른 가능성 조금
- Claude: 안정적인 맛

- Gemini: 2.5pro 때는 진짜 20~30페이지 짜리 리포트 하나 만들어줬는데 3 pro preview에서는 고등학교 에세이 수준으로 퇴보한 느낌인데 시각화가 좋아짐







코인이야기)