뒤로
하자혜
·
오픈AI vs 구글, 그 다음은?
구글의 개발자 컨퍼런스 '구글 I/O'의 개최를 앞둔 시점에 오픈AI가 올해 봄 새로운 업데이트 내용들을 발표했습니다. 가장 뜨거운 소식은 역시 신규 모델 'GPT-4o'의 공개인데요. 모델명의 "o"는 "omni(모든)"의 줄임말로, 텍스트・오디오・이미지・비디오 등 다양한 형태의 데이터를 이해할 수 있다는 점(멀티모달)을 강조한 것 같죠. 인간 대화에 버금가는 실시간 음성 대화, 다양한 언어 지원에 빠른 응답 속도까지 엄청난 진보에 큰 놀라움을 주고 있습니다.
오픈AI는 그동안 언어 모델 GPT뿐만 아니라 이미지 생성 모델, 음성 합성 모델 등을 꾸준히 개발해 왔는데요. 그 간의 연구 내용을 바탕으로, 여러 모달리티(Modality)를 통합하고 인간-컴퓨터 상호작용(Human-Computer Interaction, HCI) 측면을 강화한 결과가 이번 모델이지 않을까 싶습니다. 차기작 GPT-5도 올여름 출시 예정이라는 소문이 있죠. 'GPT-4o'의 멀티모달 성능에 GPT-5가 결합되면 얼마나 더 강력해질까요?
👇5월 20일, 모두레터 전문 보러가기👇
0
댓글
로그인 후 댓글을 남길 수 있습니다.
아직 댓글이 없습니다.