강동혁
앱토(ABTO)를 만들고 있어요. 비싼 AI 모델이 정말 매출로 이어지는지, 벤치마크가 아니라 우리 유저 반응으로 확인하는 LLM A/B 테스트 게이트웨이예요. AI 기능 붙인 서비스를 운영하는 메이커분들과 자주 이야기 나누고 싶어요. https://abto.app
비싼 모델이 정말 값을 할까?
안녕하세요, ABTO를 만들고 있는 강동혁입니다. 디스콰이엇에 ABTO 이야기를 처음 남겨 봅니다.
AI 기능이 들어간 서비스를 몇 개 만들면서 가장 오래 고민한 건 "어떤 모델을 써야 하나"였습니다. 모델사는 코딩이나 수학 점수로 성능을 설명하지만, 그 점수에는 저희 유저도, 저희 기능도 들어 있지 않았습니다.
그래서 답을 유저 반응에서 찾아보기로 했습니다. 새 모델을 일부 유저에게만 먼저 적용하고, 결제나 재방문 같은 유저 행동과 호출 비용을 나란히 놓고 비교하는 방식입니다. 이 과정을 제품으로 만든 것이 ABTO입니다.
베타에서 먼저 찾은 답은 이렇습니다.
- 한 AI 채점 서비스는 추론을 가볍게, 해설을 간결하게 바꿨습니다. 비용은 41% 줄었는데 재응시율은 오히려 18% 올랐습니다.
- 한 AI 이력서 서비스는 초안과 첨삭에서 유저가 선호하는 모델이 서로 달랐습니다. 기능마다 다른 모델을 쓰자 비용은 28% 줄고 유료 전환율은 12% 올랐습니다.
비싼 모델과 긴 답변이 항상 최선인 것은 아니었습니다. 우리 유저에게 맞는 설정을 찾는 게 중요했습니다.
직접 확인해 보고 싶으시다면, 연동은 에이전트에게 맡기면 됩니다. ABTO 스킬을 설치하고 "/abto ABTO 연동해줘"라고 입력하면 5분 안에 끝납니다.
AI 기능을 운영하고 계신 메이커분들은 지금 어떤 기준으로 모델을 고르고 계신지 궁금합니다. 써 보시고 아쉬운 점도 편하게 남겨 주세요.
앱토(ABTO)
실제 유저 반응으로 AI 모델을 고르는 A/B 테스트 서비스. 성과는 지키고 LLM 비용은 줄입니다
댓글
로그인 후 댓글을 남길 수 있습니다.
아직 댓글이 없습니다.