안드로이드에서 gpt4o 쓴다치면 영상을 폰에서 압축 -> 오픈ai 서버로 실시간 전송 -> 서버에서 압축 풀고 -> gpt4o 모델 -> 음성, 문자 출력
이런 과정을 거쳐야 함, 딜레이가 꽤나 생길수밖에 없음
근데 만약에 아이폰에서 바로 gpt4o 모델의 일부를 돌릴수 있다면 영상 압축 과정을 벡터 임베딩 과정으로 대체할 수 있음

쓰고 보니까 별로 가능성 없는 시나리오인거 같다
그냥 시리아 안녕! 대신에 챗지피티 안녕! 기능이 들어가는게 현실적이네