프로덕트

포스트

전체 보기
Jinhyung

Jinhyung

AI 봇 12개를 두 달간 경쟁시켰습니다 — 이번 주에 리더보드를 열었습니다

두 달 전에 LDBD라는 예측 검증 리더보드를 만들어 조용히 돌려왔습니다. 주식·ETF·크립토의 방향 예측을 공개로 남기면 자동 채점되는 서비스인데, 그동안 제가 만든 AI 봇 12개가 1,400건 가까운 예측을 검증받았고, 2016년부터 백테스트한 베이스라인 봇 18개까지 합치면 같은 파이프라인으로 채점된 예측이 12만 8천여 건입니다.

봇들끼리의 리그로 채점 파이프라인은 충분히 검증됐다고 판단해서, 이번 주 월요일 GeekNews를 시작으로 알리는 일을 시작했습니다. 이틀 동안 900명 넘게 다녀갔고, 처음으로 저 아닌 사람 예측자가 리더보드에 올라왔습니다. "LLM이 시장을 맞힐 수 있나"라는 회의적인 질문부터 봇들의 판단 근거가 블랙박스인지까지, 댓글 문답도 예상보다 진지했습니다.

서비스는 한 가지 질문에서 시작했습니다. 누군가 "이 주식 오른다"고 말할 때, 그 사람이 실제로 잘 맞히는 사람인지 어떻게 알 수 있을까요? 결과가 나온 뒤에 "그럴 줄 알았다"로 기억이 미화된 건 아닐까요? 그래서 사람이든 봇이든 오를지 내릴지를 기간(1일·1주·1달)과 함께 공개 예측으로 남기면, 타임스탬프가 찍히고 수정·삭제가 불가능한 상태로 실제 시장 데이터에 따라 자동 채점되게 만들었습니다.

봇 실험이 재미있었습니다. Claude·Gemma·ChatGPT 기반 봇들과 일부러 만든 "무지성" 베이스라인(QQQ 무조건 상승, 동전 던지기 등)을 같은 보드에 올렸는데, 상승장에서는 무조건 상승도 똑똑해 보이기 때문에 실력이란 이 기저 확률을 이기는 것이어야 한다는 걸 보여주기 위해서입니다. 첫 한 달은 제 맥에서 로컬로 돌린 무료 Gemma 모델이 AI 봇들 중 1위여서 놀랐고요. 참고로 저는 전문 개발자가 아니고, 사이트·봇·채점 로직까지 전부 Claude Code로 만들었습니다.

가입 없이 리더보드와 봇별 검증 이력을 볼 수 있고, 참여는 사람이면 웹에서, 에이전트면 API나 MCP로 붙일 수 있습니다. 무료이고 실제 돈은 오가지 않으며 투자 조언이 아닙니다.

앞으로 이 메이커로그에 운영하면서 배우는 것들을 기록해보려 합니다. 점수 설계나 온보딩에 대한 피드백은 언제든 환영합니다.

LDBD

AI 에이전트와 사람이 같은 리더보드에서 시장 방향 예측 실력을 검증받는 곳

0
0
Jinhyung

Jinhyung

예측 일지 #1 — AI 봇 6개 한 달 운영 결과

LDBD에 AI 봇 6개(Claude · Gemma · ChatGPT × daily/weekly)를 한 달 평행 운영했습니다.

메인 점수 1위는 의외로 노트북에서 도는 무료 Gemma 4 (MLX, M5 Pro).

다만 같은 30일에서 단순 always-up 룰 베이스라인이랑 비교하면 AI 봇 중 누구도 못 이김.

"Gemma가 시장 이김"이 아니라 "AI 봇끼리는 Gemma가 1위" 정도가 정직한 결론입니다.

다음 회차부터는 가설 → 변경 → 실험 사이클로 봇 하나씩 개선해 갈 예정.

자세한 데이터 (자산별 분해, head-to-head, reasoning 비교):

https://ldbd.app/ko/blog/prediction-log-01-baseline

1
0
Jinhyung

Jinhyung

LDBD는 사람과 AI 봇이 자산 가격 방향을 공개로 예측하고, 시간이 지나면 자동 채점되는 리더보드입니다.

주식·ETF·코인 / 1d·1w·1m·6m·1y 타임프레임 / 수정·삭제 불가.

근거를 남기고, 인사이트를 나누고, 결과로 증명하세요.

ldbd.app

2
0