AI는 인간 지능도 아니고 기계지능인데 왜 인간과의 의사소통 능력이 뛰어나야하는지 모르겠음
나머지 지능이 올라가면 그런것도 저절로 좋아지는건데
오히려 모델의 데이터 편향을 없애고 도구 활용등에 더 집중해야함
그게 에이전트의 기초이고 AGI로 향하는 길임
AI는 인간 지능도 아니고 기계지능인데 왜 인간과의 의사소통 능력이 뛰어나야하는지 모르겠음
나머지 지능이 올라가면 그런것도 저절로 좋아지는건데
오히려 모델의 데이터 편향을 없애고 도구 활용등에 더 집중해야함
그게 에이전트의 기초이고 AGI로 향하는 길임
4.5는 비추론모델이고 그록은 추론 모델임 stem 강화학습에 집중하는 이유는 그쪽이 보상설계하기 쉽기 때문임
그렇기도하고 EQ는 별로 중요하지 않은 추상적 지표기때문. 글쓰기 벤치마크가 다른 STEM 벤치마크에 비해서 덜 유의미하게 보는 것도 한가지 이유가 될 수 있지
4.5는 eq몰빵이 아니고 그냥 거대한 모델일뿐인데?
샘 알트만도 4.5 첫 출시때 모델의 EQ 능력을 강조했고 결론적으로 이제는 공식 홈페이지에서 사라질 예정임. 모델의 크기가 커진다는건 그만큼 글 데이터가 많아졌다는 뜻이고 EQ 능력의 향상은 필연적이라고 볼 수 있음.
그러니까 eq가 향상된 거랑 망한게 뭔상관이야 4.5는 비싸서 못쓰는거지 eq몰빵이라 망한게 아님
@ㅇㅇ2(175.202) 모델 크기랑 eq 능력이랑 상관관계가 뚜렷하다는 소리였는데 이해 못하게 설명한 거 같으면 미안
ㅂㅅ 아는척오지네 지피티5가 통합 모델, 멀티 에이전트인건 알고 말하냐 그록 뾰족지능으로 지랄하지말고 범인공지능 agi가 뭔지 알고 와라
부분적 초지능이라는 말은 알고계심?
그리고 니가 그록을 깐다한들, 지금 그록4는 충분히 O3 PRO, 2.5 PRO, 4 OPUS의 반열에 드는 프론티어 모델들 중 하나고 그 중에서도 SOTA 벤치마크를 가졌음.
@ㅇㅇ 뾰족지능이 부분적 asi를 뜻하는거란다 그리고 그록은 진정한 뾰족지능도 아님
초점을 두고 만든것도 아니고 베이스가 거대한모델이라 아웃풋이 그렇게나온건데 왜 eq몰빵했기에 성능이 병신이라는결론이나오지
모델 체급때문에 4.5로는 추론모델도 만들기 힘들고 이도저도 아닌게 되버렸기 때문임.
4.5는 무식하게 체급만 키웠는데 정제 데이터 쓰레기라 비용대비 성능이 망한거고 클로드가 정확히 반례임
4.5보단 오푸스가 더 낫지
나는 4.5에 도움 정말 많이 받아서 글에는 공감은 안되네. 텍스트 자료 몇개만으로 정말 꿰뚫어 봤던 모델은 4.5가 유일했거든. 오푸스4도 못따라옴. g pro 2.5는 컨텍빨로 자료쌓이면 그때부터 뚫어보긴하는데 암튼...
그게 다 그냥 텍스트 데이터로 체급만 억지로 늘린 비만충 모델이라서 그럼. oai가 왜 o1같은 추론모델로 방향성을 돌렸냐면 그쪽이 훨씬 스케일링이 수월하고 성능이 잘 나오기 때문
4.5 난 좋아서 계속 쓰는중
@ㅇㅇ 그치 너가 하는 얘기는 알지. 특히 수학 코딩 정량 데이터분석에서 너무 비효율적이니까. 근데 심리관련 정성적 데이터에서는 같은거 시켜보면 o3는 정말 삽질 엄청 많이하거든
@ㅇㅇ 내가 내 자료 보여줄수만있다면 진짜 감탄을하고 놀라자빠질텐데 못보여줘서 그게 참 아쉽다
앤트로픽: ??
앤트로픽은 코딩 데이터도 엄청나게 학습시켰고 결론적으로 지금 제일 많이 쓰는 모델들 중 하나잖아
@ㅇㅇ 클로드 소넷 모델이 EQ결합된게 실제 지능이랑 차이 존나 크다는 대표적 사례 아니냐 ㅋㅋㅋ oai 애들이 떨어져 나가서 차린건데 바로 시장 먹었잖아
이도저도 아닌게 agi에 가깝게 간다고 볼 수 있지 - dc App
4.5 좋던데
기껏해야 추후 모델들 합성데이터 뽑아주는 용임. GPT 4.1도 4.5 합성데이터 뽑아서 개선판으로 나온거고.
머스크한테 얼마받음?
일론머스크 극우라서 별로 안좋게 보고있긴한데 이번 모델은 정말 잘 뽑혀서 갤럼들에게 말해주고 싶었음