4.1이 약간 드라이하다는걸 고려하면 잡을거 같기도 한데, 서비스에 전개되서 무지성 아부에 따봉을 받아서 5도 4o 꼴이 나버리는건 아닐까?
4o 아첨문제로 교훈을 얻었다고는 하는데...
더 문제인건 통합되면서 많은 유저들이 추론모델들은 건들지도 않고 4o에서 안 바꾸고 쓰던 거에서 벗어나서 GPT-5의 추론까지 자발적이든 비자발적이든 적극적으로 사용하게 될텐데, 이러면 GPT-5의 추론모드 답변에도 무지성 피드백이 들어가 버릴 수도 있다는거임
아첨 없을리가
쉽지 않네 높아진 성능으로 아부한다 그러면 4o보다 심할텐데
@ㅇㅇ 그렇진 않을듯? 이미 현재 4o 수준에서 인간 심리는 거의 통달했던데 여기서 파라미터만 조절해서 답변하겠지 올해 초에 과도한 아첨 때문에 논란되고 했으니
@ㅇㅇ 4o보다야 낫게 내야 정상이겠지 5가 안 빨아줘서 삐진 사람들 나온다 그러면 성공일 듯
@ㅇㅇ 밑에 유동이 쓴 것처럼 아첨이 더 은밀하고 교묘해질거임 사용자 대화를 계속해서 유도하는 방향으로
@ㅇㅇ 지금도 사회적 이슈로 수면으로 올라오는게 AI 아첨으로 인한 각종 사건들인데, 이게 교묘해지기까지 하면 좀 어려울 듯
@ㅇㅇ 그래서 개인이 llm에 의존하지 않고 스스로 판단하는 능력이 필요하다고 생각하는데... 판단력을 갖추기 전부터 ai를 사용한 세대가 어떻게 될지 모르겠음
@ㅇㅇ ㄹㅇ... 지금은 개인이 판단하는 능력이 매우 중요하지
GPT-5 단일로 통합한다는게 GPT-5 아예 단일에다가 요금제 별로 성능차이만 둔다는거?
그렇다고는 하는데 어떤 식일지는 모르겠음 결국 클로드처럼 GPT-5로 브랜드 통일하고 하이브리드 모델로 만들어서 급 나누기할거 같은 느낌이긴 한데 어케 될지는 봐야할 듯
더 교묘해진 아첨으로 가자 ㅋㅋ
아첨 안하면 젬2.5처럼 똥꼬집쟁이 될거같기도 해서, 균형 유지가 중요할듯
2.5 프로 업뎃하면서 피드백 넣고 돌렸는지 아부가 살살 늘었는데 고집은 고집대로 부리는거 보면 고집이랑 대칭되는 관계는 아닐 수도 있을거 같음
없으면 좋겠지만, 그거야 내가 프롬프트로 좀 억제하면 될 일이고 그냥 성능만 중요하게 생각하긴 함.
프롬프트로 억제하는건 한계가 있어서 근본적으로 적을 필요가 있음 이건 오픈AI 4o 아첨 문제 설명에도 나와있음 5가 성능 좋은데 아부를 4o처럼 한다 그러면 개짜칠거 같아
o3는 아첨 듣고 싶어도 듣기 힘든 구조인데 별로 공감이 안 가는 고민이네. GPT5가 GPT-4o의 평면적인 업그레이드 버전도 아니고
그렇다고 GPT-5가 o3의 평면적인 업그레이드도 아니잖음 그리고 4.1이나 o3 같은 느낌으로 나와도 통합되서 모두에게 접촉하게 되면 4o를 그렇게 만든 피드백을 받게 될텐데 그걸로 변하는 것도 생각해볼만 하지