GPT 5.1 Thinking > Gemini 3.0 Thinking
동일한 메모리를 부여하고,
둘 다 Thinking (사고모드) 작동시
추론의 깊이가 GPT 5.1 이 압도적임. - (전문성이 월등함)
멀티모달은 Gemini 3.0 가 압도적이고.
Gemini 는 정말 딱... 중/고등 수준.
연계적으로, 추론 조건화 구조화 확률화가 너무 부족함.
과거 초창기 GPT o3 model 에서 + 실시간 데이터 Gathering 이 빨라진 느낌 이외에는 별 호응 없음.
다만, 멀티모달이 좋아서,
단순 작업용으로만 딱 적합한 듯.
개인적으로는 GPT 가 압승임. - (유료 기준)
벤치는 잼3이왜이김
벤치는 모르겠음. 우선 제 분야에서만 테스트 했을 때 체감이 압도적임.
어? 혹시 게이 아니노? 여기서 보니까 반갑다. ㅎㅎㅎ
안자니
@레이븐(118.219) 자다 깼다능?
일단 두 모델의 기본 추론 시간이 너무 확 차이가 나서... 반대로 gpt pro vs 딥씽크는 희한하게 후자가 더 오래 추론하더라.
Gemini 3.0 이 3만원이던데.
GPT oAI 에서 3배(9만원) 까지, 유료비용 끌어올린다고 해도, 난 GPT 5.1 한표 던질 듯. // 이건 그냥 질적으로 너무 차이남
Gemini 3.0 사고모드 (유튜버 x밥 자칭 존문가 나와서 하는 뜬구름 잡는 소리) /// GPT 5.1 Thinking 모드 (대학원생 출신 과장급, 책임급 현업이 하는 소리)
ㅇㅎ ㄷㄷ
나도 ai분야 연구공부코딩 하는데 gpt가 더 좋은 거 같다 추론도 깊이있고 어느정도 전공 레벨이 되면 gpt가 나은듯
Gemini 3.0 pro 를 Ph.D 까지 끌어 올려서 답변 유도해도, 그냥 뜬구름 잡는 소리 함 // 그냥 잘 모르는 신입이 있어보이게끔 경력처럼 말할려고 하는데, 헛소리 및 깊이도 없고... // 왜 이런거 돈까지 줘가면서 쓰는지 이해가 안됨. 그냥 사기꾼 같음.
나도 전공분야 한정 지피티가 훨 나음.
근데 gpt는 말투가 너무 좆같음 아까 노션에서 5.1이 퍼포먼스 괜찮다고 쓰긴했는데 뭐 하나 시키면 몇번이고 닥달해야하는거 좆같음 그냥 시키면 시키는대로 하는법이 없음
딱 지식을 깊이있게 서술하는부분에서만 괜찮다고 느낌
아니 씨발 지피티 이새끼는 열받는게 어떤 과제를 할지 하나부터 열까지 세세하게 적어놔도 이렇게 할까요 저렇게할까요 쳐물어보고 있음 제미나이는 시키지도 않았는데 뭐하고있는게 짜증남
그거는 미세 메모리 조정 하면 됨. 입맛에 맞게 고추가루좀 더 넣어달라고 하고, 소금 뿌려 달라고 하면됨 /// 근데 Gemini 3.0 이건.. c블.. 그냥 양념으로 되는 수준이 아님... // 근본 태생 자체가 노답임. // 그냥 멀티모달 노가다 작업 시키는 용도 딱 그정도인 듯.
@ㅇㅇ 제미나이는 사고의 수준이 중고딩 수준임. 잘쳐줘야 대학교 출석하는 애들이 x도 모르면서 헛소리를 불라불라 하는 중.
나는 2.5때는 그렇게 느꼈는데 내 분야 한정은 젬이 지금은 gpt 5.1이랑 비슷하다고 느낌 - dc App
5.1 thinking mode 로 비교하면 어떠심?
해당 댓글은 삭제되었습니다.
5.1 Thinking 모드로 해보셈.
@ㅇㅇ ? 그런 모드도 있음?? // 5.1은 Auto, Instant, Thinking (standard), Thinking (extended), 심층리서치 .. 이렇게 있는거 아님?
@글쓴 ㅇㅇ(211.244) 그렇게하면 자동으로 라우팅됨 api로 쓰면 추론 high 지정가능
어떤 분야로 테스트했는지 물어봐도 됨? - dc App
실제로 테스트했을리가 없잖아 ㅋㅋ - dc App
@ㅇㅇ 내가 싫어하는 타입의 사람이넹. 하층민 수준의 화법. ㅅㄱ
@글쓴 ㅇㅇ(211.244) 하층민수준이라고 바로 박는거보니 그 가벼움이 알만하다
어학 공부랑 노래 가사 쓰는데에 ai이용하는데 난 gpt가 제미니보다 낫다고 생각함
창의쪽이랑 어학쪽은도 그런가보네... 뭐지.. Gemini 가 너무 밴치에만 최적화 된 모델인건가;;? // 구조화된 분석이랑 해결안이 너무 아마추어임. 지잡대 x밥 사원 대리급 수준.
지피티가 벤치 뾰족 지능이라는거는 어떤거에 근거한거양? 해외포럼이랑 완전 다른 말을 적었네..?
@글쓴 ㅇㅇ(211.244) 실제로는 지피티가 RL 빡쎄게 돌린 경량 뾰족지능이고 제미나이가 사전학습 크게 잡은 범용 모델이라잖아 그러니까 특정 벤치가 아니라 모든 벤치 다 앞서지 네가 활용 범위가 좁은가보네
@ㅇㅇ5(114.205) 물론 제미나이와 비교시 말한 거임 OAI도 애시당초 좁밥은 아니지
@ㅇㅇ5(114.205) 근거가 뭐임...? // 활용 범위랑 벤치 최적화랑 도저히 상호 상관성이 연결이 안되는데...? // 내가 벤치 모델 테스트 고수준 수준의 질문만 한다는건가?
@ㅇㅇ5(114.205) 그런데 난 동일한 질문을 했는데, 그렇다면 벤치점수가 더 높은 제미나이3.0 이 깊이 있는 전문성 답변을 줬어야 하는데.. // 활용범위란 변수를 제거한 조건이닌깐.
@글쓴 ㅇㅇ(211.244) 무슨 근거? 이게 근거가 필요한 얘기인가? 며칠동안 계속 나온 얘기잖아. 네가 검색이 중요한 질문만 한다던지 그런 거 아니야? 난 수학이라, 체감 확 되는데
@ㅇㅇ5(114.205) ....? 나.. 지금 너의 수준이 의심되기 시작했어.. // 너의 말에 의하면 'GPT 5.1 벤치 최적화 뾰족 지능이고, Gemini 3.0 은 범용 6각형 모델' 이라는 거잖아. // 여기서 사실적인 부분은 벤치마크는 Gemini 가 더 높아. // 결국 어떠한 분야든 상관없이 동일한 질문을 하면 Gemini 3.0 이 GPT 5.1 보다 깊이 있는 전문성 있는 답안을 도출해야 한다는 것인데 // 활용 범위가 좁고 넓음의 문제가 아니잖아? // 나 지금 진심으로 너의 능지가 의심되닌깐.. 글 다시 읽어보고 대댓글 줘봐.
@글쓴 ㅇㅇ(211.244) 더 성의있는 대답이 기준이라면 네 말에 나도 공감함 5.1 되면서 출력이 아주 늘어나서 요새 아주 성심성의껏 대답해주는 건 맞음. 근데 수학 돌렸을 때, 5.1은 생각만 6-7분 하다가 뻗는 경우가 많음. 제미나이는 일찍 해결하고.
@ㅇㅇ5(114.205) ;;; 너.. 말 바뀌네.. 본문과 대댓글에 보면, 답변 도출내용에 대한 LLM 간의 '성의' 차이라고 한 적 없어. // 해당 분야에서 전문성을 논하는거지 // 내가 보기에는.. 너 지금 기본적 연역 추론도 실생활에 적용 못하는 수준 것 같은데... // 너라면.. 중고딩 수준 Gemini 가 딱 맞겠다... // 너의 위치에서 항상 최선을 다해주길 바래. 대한민국의 발전을 위해서.
@글쓴 ㅇㅇ(211.244) 가정했잖아. ~~라면 이라고 말이야.
벤치가 올랐다고 하는데 체감도 안됨 실사용에서 5.1에 비하면 좆구린거같음 ㄹㅇ 그럼 검색이라도 잘해야하는데 검색툴도 쓰레기라 걍 좆같음
나도 비슷한 느낌. 심층적 사고 능력이 떨어짐. 아마 방대한 학습케이스로 커버한 모델인 것 같은데 가장 비슷하게 느낀 모델은 GPT 4.5.
해당 댓글은 삭제되었습니다.
그냥 제미나이는 노가다 작업 대용임. // 제 기준에선 이상 그 이하도 아님 느낌.
@글쓴 ㅇㅇ(211.244) 비하받을 정도로 안좋은 모델은 아니라고 생각함. 이미지 처리 능력은 분명히 퀀텀점프했고, 사전학습 스펙트럼이 워낙 넓어 정형화된 교육, 언어 번역 같은 필수 영역에서도 GPT를 넘었다고 생각됨. 이 부분을 높게 평가하고 다소 아쉬운 점은 내가 바라는 목적에 맞는 고차원적인 알고리즘 능력이나 판단 능력이 벤치에서 기대했던 성능보다 떨어진다는 점 뿐임
@ㅇㅇ6(122.40) 동의
제일 실망한 부분은 코딩이고. 어처구니 없을 정도로 기본적인 구현에서 미흡한 처리가 생기거나 지시사항을 무시하고 다른 로직은 건드리는 경우가 많았음. 유튜브에서 혹은 AIS에서 간단한 목업 구현이 잘된다고 코딩 능력이 좋다고 하는데, 그건 그냥 시각화 영역인거지 본질적인 알고리즘 능력과는 다른 영역이라고 생각함. 마치 많은 HTML , CSS , JS 를 학습하고 SVG 그리듯이 UI를 구축하는 느낌인데, 이건 프로그래밍을 잘하는게 아니라 그냥 UI를 잘짜는 것 뿐임.
맞음. 프론트엔드는 괜찮은데 백엔드가 약간씩 뭔가 빠져있음. - dc App
실시간 데이터 Gethering이 아니고 데이터 Gathering
답변의 깊이는 gpt5쪽이 더 깊긴 한데 지능 자체는 제미나이가 더 높음. 그냥 답변 자체를 하기 귀찮아하는 천재 느낌임 - dc App