삼전 하닉이 한국 부양 중
일단 LLM에선 아님
llm도 미국,중국 아니면 이길나라가 없음
@ㅇㅇ 프랑스 캐나다 uae 영국
@약팔이아님 유럽쪽 독자모델들 한국에 밀림
@ㅇㅇ 뭐가 밀리는데? 벤치 점수표 있으면 알려줘 mistral이나 Falcon이 내놓은 LLM이 밀린 벤치가 어떤건지 궁금함
@약팔이아님 k1 기준으로 작년 8월에 나온 딥식 3.1보다 나은성능을 보여주는데 지금 유럽쪽에 딥식 3.1보다 나은 ai가 뭐가있음
@ㅇㅇ 뭔소리야? 영어 벤치에서 k1이 딥식3.1을 이겼어?
@약팔이아님https://zdnet.co.kr/view/?no=20260107110755#_enliple
@약팔이아님 영어기준으로 수학, 코딩 전부 딥식보다 뛰어남
@ㅇㅇ 아니 영어 벤치 이겼냐고 gpqa mmlu 모름?
@약팔이아님 니가 들고와보샘 지금 유럽쪽 모델들중에 수학이든 코딩이든 딥식 3.1 넘는게 있노?
@ㅇㅇ ㅇㅇ>>저렇게 얘기해도 못알아쳐먹음 먹금해야됨 진짜답답한스탈
@ㅇㅇ2(58.233) a.x k1이 언어벤치에서 mmlu pro기준 딥식 3.1보다 약간 낮고 수학, 코딩이 더 좋아서 넘었다는 소리가 나오는건데 얘가 주구장창 말하는 미스트랄윽 라지3은 무엇하나 딥식 3.1 넘는게 없잖음?
@ㅇㅇ devstral 123b 검색
@ㅇㅇ mistral large 3 2512 검색
@약팔이아님 검색이고 나발이고 니가 가서 라지3 벤치를 찾아봐라 수학, 코딩 다 딸리잖아 언어는 mmlu기준으로 소넷 3.5보다 딸리고
@약팔이아님https://medium.com/@leucopsis/mistral-large-3-2512-review-7788c779a5e4여기서도라지3은 mmlu기준으로 85점이고 mmlu pro로 가면 80점대라고 나오잖아
삼전 하닉이 한국 부양 중
일단 LLM에선 아님
llm도 미국,중국 아니면 이길나라가 없음
@ㅇㅇ 프랑스 캐나다 uae 영국
@약팔이아님 유럽쪽 독자모델들 한국에 밀림
@ㅇㅇ 뭐가 밀리는데? 벤치 점수표 있으면 알려줘 mistral이나 Falcon이 내놓은 LLM이 밀린 벤치가 어떤건지 궁금함
@약팔이아님 k1 기준으로 작년 8월에 나온 딥식 3.1보다 나은성능을 보여주는데 지금 유럽쪽에 딥식 3.1보다 나은 ai가 뭐가있음
@ㅇㅇ 뭔소리야? 영어 벤치에서 k1이 딥식3.1을 이겼어?
@약팔이아님
https://zdnet.co.kr/view/?no=20260107110755#_enliple
@약팔이아님 영어기준으로 수학, 코딩 전부 딥식보다 뛰어남
@ㅇㅇ 아니 영어 벤치 이겼냐고 gpqa mmlu 모름?
@약팔이아님 니가 들고와보샘 지금 유럽쪽 모델들중에 수학이든 코딩이든 딥식 3.1 넘는게 있노?
@ㅇㅇ ㅇㅇ>>저렇게 얘기해도 못알아쳐먹음 먹금해야됨 진짜답답한스탈
@ㅇㅇ2(58.233) a.x k1이 언어벤치에서 mmlu pro기준 딥식 3.1보다 약간 낮고 수학, 코딩이 더 좋아서 넘었다는 소리가 나오는건데 얘가 주구장창 말하는 미스트랄윽 라지3은 무엇하나 딥식 3.1 넘는게 없잖음?
@ㅇㅇ devstral 123b 검색
@ㅇㅇ mistral large 3 2512 검색
@약팔이아님 검색이고 나발이고 니가 가서 라지3 벤치를 찾아봐라 수학, 코딩 다 딸리잖아 언어는 mmlu기준으로 소넷 3.5보다 딸리고
@약팔이아님
https://medium.com/@leucopsis/mistral-large-3-2512-review-7788c779a5e4
여기서도
라지3은 mmlu기준으로 85점이고 mmlu pro로 가면 80점대라고 나오잖아