NULNUL Harness — 프로젝트에 맞게 진화하는 AI 코딩 하네스
소개
Claude Code나 Codex로 개발하다 보면 프로젝트가 커질수록 이런 것들이 하나둘 늘어납니다.
어떤 Skill을 써야 하는지, Agent를 몇 개 둬야 하는지, 이전 작업은 어떻게 이어갈지, 지금 설정이 정말 도움이 되는지, AI가 완료했다고 한 결과를 믿어도 되는지.
NULNUL Harness는 이 AI 개발 환경 자체를 프로젝트에 맞게 관리하는 오픈소스 도구입니다.
사용자는 원하는 결과를 말하면 됩니다.
예약 API에 validation을 추가하고
기존 동작이 깨지지 않았는지 확인해줘.
NULNUL은 현재 저장소를 먼저 확인하고, 이전에 검증된 프로젝트 경험 중 필요한 것만 불러옵니다.
그다음 현재 작업에 필요한 Capability를 고르고, 작업을 수행한 뒤 실제 프로젝트의 테스트·빌드·검증 명령으로 결과를 확인합니다.
사용자 요청
↓
프로젝트 / 이전 경험 확인
↓
필요한 Capability 선택
↓
작업
↓
실제 프로젝트 검증
↓
검증된 Experience
↓
다음 작업에 필요한 것만 재사용
NULNUL 3.0에서 하고 싶은 것
NULNUL의 목표는 Skill이나 Agent를 많이 모으는 것이 아닙니다.
이 프로젝트에 가장 잘 맞는 AI 개발 환경을 만들어 가는 것입니다.
그래서 기존 Capability에 문제가 없다면 그대로 KEEP하고, 실제 작업에서 반복적인 약점이 확인될 때만 UPGRADE, REPLACE, MERGE, RETIRE, CREATE 같은 변경을 검토합니다.
Agent 역시 처음부터 여러 개를 만드는 것이 아니라 기본적으로 단순한 실행 경로에서 시작합니다. 여러 Agent가 실제 결과를 더 좋게 만들 근거가 있을 때만 구조를 확장합니다.
또한 프로젝트 간에는 대화 내용이나 코드를 그대로 공유하지 않고, 검증된 경험에서 추상화된 정보만 제한적으로 재사용하도록 설계했습니다.
왜 만들었나요?
AI 코딩 도구를 쓰다 보니 정작 개발보다 AI를 위한 환경을 관리하는 일이 점점 늘어나는 게 아쉬웠습니다.
새로운 Skill이 나오면 넣어야 할 것 같고, Agent 구조도 계속 고민하게 되고, 세션이 바뀌면 이전 작업을 다시 설명해야 하고, 설정이 쌓일수록 무엇이 실제로 도움이 되는지도 알기 어려워졌습니다.
그래서 반대로 생각했습니다.
사용자는 만들고 싶은 것에 집중하고, AI 개발 환경은 실제 프로젝트 경험을 바탕으로 스스로 정리되고 개선될 수 없을까?
그 질문에서 NULNUL Harness를 만들기 시작했습니다.
현재
NULNUL Harness 3.0은 OpenAI Codex와 Anthropic Claude Code를 지원하는 오픈소스 프로젝트입니다.
Session Continuity, Capability Pack, Verification, Experience/Memory, Capability Natural Selection, Agent Evolution, Guarded Harness Evolution, Cross-Project Generalization 등을 하나의 흐름으로 구성했습니다.
현재 공개 테스트 스위트는 431개 통과 상태이며, 모든 진화 기능이 무조건 변경을 만들어내는 것이 아니라 검증 가능한 근거가 없으면 현재 상태를 유지하도록 설계했습니다.
아직 모든 종류의 진화가 실제 프로젝트에서 자연 발생한 사례까지 충분히 쌓인 것은 아닙니다. NULNUL 3.0은 그 부분을 과장하기보다, 검증된 것과 구현된 것을 구분해서 공개하고 있습니다.
오픈소스라서 자유롭게 설치하고 코드와 내부 동작을 확인할 수 있습니다.
웹사이트 URL
https://github.com/SeoNaRu/nulnul-harness