단순하게 이미지뿐만 아니라, 이미지에 있는 페이지내 텍스트들도 동시에 학습한건가.
보통 이미지 = 이미지정보텍스트 이정도만 라벨링 하는데, 이미지랑 이미지가 있던 페이지의 텍스트들도 전부 라벨링해서 학습 시키면....근데 그게 되나? 우앙 신기하넹.
이유를 물어보면 되잖아 - dc App
할루시네이션 아냐?
전에 다른 갤럼이 올린거보니까 구글 렌즈에서 이미지 텍스트 추출에 사용되는 기능을 바드에도 섞어놨나봐. 이미지 텍스트 인식은 진짜 잘하는듯... 제미니는 더 좋아질건데 과연 ㄷㄷ...
인터넷에 널린 이미지의 대다수가 구글에 있고 얘네가 그런 걸 분류 및 데이터화 잘하는 걸 감안하면 비전 성능이 좋을 수밖에 없는 이유가 있구만...
크롬이면 사진에 우클릭하고 구글에서 이미지 검색 눌러보세요. 검색해서 나온 이미지 클릭하면 바드가 답변한 내용 토씨 하나 안틀리고 그대로 있음. 즉, 바드는 이미지를 분석한게 아니라 검색결과를 띄워준것 뿐임.
스트리트뷰 같은거 데이터로 활용하는거 아닐까? 구글이 데이터 갑이긴 함
자전거용품 간판은 말하기 전에 몰랐네.
구지면은 아니고 강정고령보네 ㅋㅋㅋ 그래도 대구는 맞다
저런 특별한건 사람들이 블로그나 인스타 트위터 각 종 사이트에 엄청 올려서 그걸 취합하는거지 뭔 저 그림만보고 유추한줄 아나ㅋㅋㅋㅋ 지능수준
개좆드를 갖고 오네ㅋ
단순하게 이미지뿐만 아니라, 이미지에 있는 페이지내 텍스트들도 동시에 학습한건가.
보통 이미지 = 이미지정보텍스트 이정도만 라벨링 하는데, 이미지랑 이미지가 있던 페이지의 텍스트들도 전부 라벨링해서 학습 시키면....근데 그게 되나? 우앙 신기하넹.
이유를 물어보면 되잖아 - dc App
할루시네이션 아냐?
전에 다른 갤럼이 올린거보니까 구글 렌즈에서 이미지 텍스트 추출에 사용되는 기능을 바드에도 섞어놨나봐. 이미지 텍스트 인식은 진짜 잘하는듯... 제미니는 더 좋아질건데 과연 ㄷㄷ...
인터넷에 널린 이미지의 대다수가 구글에 있고 얘네가 그런 걸 분류 및 데이터화 잘하는 걸 감안하면 비전 성능이 좋을 수밖에 없는 이유가 있구만...
크롬이면 사진에 우클릭하고 구글에서 이미지 검색 눌러보세요. 검색해서 나온 이미지 클릭하면 바드가 답변한 내용 토씨 하나 안틀리고 그대로 있음. 즉, 바드는 이미지를 분석한게 아니라 검색결과를 띄워준것 뿐임.
스트리트뷰 같은거 데이터로 활용하는거 아닐까? 구글이 데이터 갑이긴 함
자전거용품 간판은 말하기 전에 몰랐네.
구지면은 아니고 강정고령보네 ㅋㅋㅋ 그래도 대구는 맞다
저런 특별한건 사람들이 블로그나 인스타 트위터 각 종 사이트에 엄청 올려서 그걸 취합하는거지 뭔 저 그림만보고 유추한줄 아나ㅋㅋㅋㅋ 지능수준
개좆드를 갖고 오네ㅋ