aime가 존나차이남
심지어 모델사이즈 절반임 심지어 10분의 1사이즈랑 비빔
[일반] qwen3 235b a22b(이전소타) 랑 oss 벤치비교
익명(116.32)
2025-08-06 02:17
추천 2
댓글 15
다른 게시글
-
gpt oss모델 mmmlu 개좋네 ㅋㅋ[일반] 익명(175.210) | 25.08.06추천 0
-
아가리 턴다고 욕했더니 바로 출시하노ㅋㅋㅋ [1][일반] 익명(121.135) | 25.08.06추천 0
-
라마 4 개발진들 저거보면 무슨 생각들까 [3][일반] 익명(early8377) | 25.08.06추천 0
-
KAI 업체들 ㅈㄴ황당하겠네 ㅋㅋ [4][일반] 메론맛콜라..(victim4811) | 25.08.06추천 0
-
근데 허깅페이스에 올라간 모델도 OAI가 서비스하는 거임?[일반] 익명(119.202) | 25.08.06추천 0
-
오픈라우터에 oss 떴다 [6][일반] 익명(116.125) | 25.08.06추천 2
-
oss 아파치 라이센스인데 한국기업 가져다 써도됨 [1][일반] 익명(211.178) | 25.08.06추천 0
-
자기 컴에서 못 돌려서 슬프면 ㄱㅊㅋㅋㅋ [4][일반] 익명(221.165) | 25.08.06추천 0
-
Gpt 무료버전은 수학 잘 못 푸네? [4][일반] 익명(117.110) | 25.08.06추천 0
-
근데 0.1 좋아진게 체감이 감?[일반] 익명(58.227) | 25.08.06추천 0
그냥 한세대는 차이나는거같은데 ㄹㅇ - dc App
Qwen은 툴 안 쓴 거고 oss는 툴을 쓴 거야...
노툴임?
아니 oss는 대놓고 툴 사용이라고 적혔고 Qwen은 당연히 노 툴 pass@1이지
@글쓴 ㅇㅇ(116.32) 글고 씨빨 qwen은 비추론 모델을 가져오고 있네 하...
나온게 저거뿐인데 시발그러면 추론이랑 툴사용 쳐올리던가
@글쓴 ㅇㅇ(116.32) 에라이 븅신새끼야 ㅈ같이 올려놓고 적반하장은 씨발 ㅋㅋ
그런데 Openai AIME 결과에서는 tool 도구를 썼다고 나오는 것 같아서 별로 공정한 비교는 아닌 것 같습니다.
그 openai는 툴 사용 벤치도 섞여있음
그리고 나온 Qwen 모델은 Instruct 버전이라서 reasoning을 하지 않는 반면 OpenAI모델은 reasoning을 기본적으로 하는 것으로 알고 있습니다.
Reasoning을 사용하는 모델 버전은 Qwen/Qwen3-235B-A22B-Thinking-2507 으로 알고 있습니다.
오케이 확인해보고 정정할게
@ㅇㅇ1(119.202) 찾아보니 Qwen/Qwen3-235B-A22B-Thinking-2507 AIM E25 는 92.3 점을 받았네요. 따로 주석이 없는 것을 보니 tool을 사용하지 않은 것 같습니다.
@ㅇㅇ1(119.202)
https://huggingface.co/Qwen/Qwen3-235B-A22B-Thinking-2507
찾아서 이미올림 근데 그것도 노툴임? 확실한가?