요즘 나도 그렇고 나보다 어린 학생들은 거의다 공부할때 LLM 쓰는데, 그러면 그 데이터를 보고 만드는 결과물을 다시 LLM이 학습하고 다시 우리가 그걸 보고 학습하고 반복하면 나중에 사회가 수십 년 전의 데이터에 overfitting되지 않을까?
[%] 먼가 밑에 ai글 보고 생각난건데
익명(106.101)
2025-11-27 21:52
추천 0
댓글 4
다른 게시글
-
넷마블 해킹 611만명 유출 [1][%] 익명(175.197) | 25.11.27추천 0
-
근데 ai가 개발을 하잖아 [25][%] 익명(211.184) | 25.11.27추천 0
-
생각해보니깐 llm때문에 대학과제 대행으로 쌀먹하는거 [2][%] 지피지기(knon0501) | 25.11.27추천 0
-
오늘 회사에서 기립 박수 받음 [3][%] 익명(yayakon) | 25.11.27추천 1
-
신입 C# 유지보수하는데 [2][%] 익명(211.186) | 25.11.27추천 0
-
지금 코딩 배우려는 새끼들은 대가리 돌임? [6][%] 익명(112.172) | 25.11.27추천 0
-
C++ 배우려고 하니까 추천으로 모두의코드 많아서 보려고 했는데 [2][%] 익명(humanity7886) | 25.11.27추천 0
-
전자정부프레임워크가 잘 이해가 안되는게 [5][%] 익명(114.30) | 25.11.27추천 0
-
인텔리제이 언제 jvm25 로 올려주는건데 ㅠ[%] 익명(175.197) | 25.11.27추천 0
-
전자정부프레임워크도 자바 17을 쓰다니 [2][%] 익명(175.197) | 25.11.27추천 0
그런 결과물은 학습 데이터로 안써 데이터과학자들이 비싼돈받는 이유가 오버피팅 피하려는거임
맞음 printf 쓰면 되는데 느리다고 char buffer[1024] 만들고 fwrite 해서 하는게 제일 효율좋다고 인기베스트셀러 되서 쓰다가 미래에 printf버리고 아까 말한대로 그따구로 씀 ㅈㄴ 병신됨
윗댓처럼 학습 데이터로 안쓰기 위해 인력 갈아 넣는 중
그럴 일은 없음 학계에선 진작에 벤치마크 데이터 생성할 때도 전문용역 아웃소싱 맡겨왔고 대기업들도 데이터 좆병신인 거 다 거르는 중이라 개잡 데이터로 학습하는 게 아님