뒤로
lee
lee ·

작지만 강한 허깅페이스 모델 SmolVLM


온디바이스에서도 멀티모달 사용
진짜 놀랐던 게, 256M 파라미터로 이미지+텍스트 처리가 된다는 거예요. 그것도 1GB RAM도 안 되는 환경에서 브라우저에서도 돌아가고 그동안 멀티모달 AI 쓰려면 클라우드 API 써야 했는데, 이제 개인정보 걱정 없이 로컬에서 바로 가능해졌어요. 라즈베리로 테스트 한번 해보고 싶네요.

SmolVLM → SmolVLA: 로봇에 대한 관심이 진화
SmolVLM이 이제 SmolVLA로 넘어가면서, 단순히 “이미지를 보고 이해하는 AI”에서 → “실제로 로봇 팔을 움직이는 AI”로 진화했어요. 이건 그냥 VLM의 발전이 아니라, 로봇의 뇌가 진짜 작동하기 시작한 순간 같아요.

SmolVLM 데모 링크 : https://lnkd.in/g_WKMrAT

2

댓글

로그인 후 댓글을 남길 수 있습니다.

아직 댓글이 없습니다.