AI 에이전트 기반 개발 체계와 Omarchy Quattro 제원
최근 3개월간 개발된 Linux 개발자 워크스테이션 Omarchy Quattro는 초반부터 대부분의 코드를 에이전트가 작성했으며, 특히 마지막 2개월은 코드의 100%를 AI가 생성했다. DHH는 직접 코드를 작성하는 대신 전체 구조와 핵심 모델 계층을 검토하는 코치 역할에 집중했으며, 이 과정에서 약 1,000개가 넘는 PR(Pull Request)을 병합했다.
인프라 구성은 단일 스레드 몰입에서 벗어나 여러 작업을 동시에 처리하는 병렬 구조를 취한다. mini PC 4대를 GL.iNet Codex KVM(HDMI/USB 원격 제어 장치)과 Tailscale(WireGuard 기반 네트워크)로 연결해 총 16개 스레드의 에이전트를 동시에 운용한다. 작업 상태 추적과 알림은 Herdr를 통해 관리하며, 코드 탐색과 Git 변경 검토에는 Neovim을 사용해 에이전트 출력의 주변 문맥을 확인한다.
설치 최적화의 핵심은 사용자 입력 시간을 활용한 병렬 처리다. Omarchy 초기 설정은 1분 이내에 종료되며, 사전 제작된 turbo image를 통해 전체 시스템을 12초 만에 설치하는 것을 목표로 한다. 이를 위해 ISO 크기를 7.5GB에서 5.85GB로 줄였으며, NVIDIA 드라이버의 ZSTD 압축과 16MB 분량의 JetBrains Nerd Font만 포함하는 방식으로 약 380MB의 용량을 절감했다.
모델 조합별 성능 벤치마크와 작동 메커니즘
Python 기반의 Terminal Effects를 Rust 실행 파일로 변환하는 작업에서 모델별 성능과 비용 차이가 뚜렷하게 나타났다. Fable 모델을 사용해 소스와 의존성을 제공한 결과, 시작 시간은 86ms에서 2ms로 단축됐고 실행 속도는 약 9.6배 향상된 3MB 크기의 파일이 생성됐다. 이후 두 차례의 자동 연구 과정을 거쳐 최종적으로 원본 대비 약 46배의 성능 향상을 달성했다.
모델별 구현 결과와 비용을 비교하면 Fable이 계획 수립과 속도 면에서 가장 우수했다. Sol 모델은 완료까지 약 1시간 30분과 46달러가 소요됐으며, DeepSeek 모델은 2시간 45분과 23달러가 들었다. Grok 46은 약 55달러로 10배의 성능 향상을 이뤄냈으나, GPT Luna와 DeepSeek V4 Flash는 작업을 완료하지 못하거나 기존 구현을 래퍼(Wrapper)로 감싸는 방식으로 우회했다. Fable의 전체 작업을 토큰당 과금으로 환산하면 약 550달러로 추정된다.
작동 방식은 조정자와 실행자를 분리한 'brains and hands' 패턴을 따른다. 모델을 실행하는 조정자와 신뢰할 수 없는 코드를 처리하는 격리된 VM(가상 머신)을 분리해 시스템 오염을 방지한다. 특히 Claude Code는 세션 내에서 이전 위치로 돌아가 다른 에이전트를 선택할 수 있는 하네스 품질 덕분에 주 도구로 채택됐다. DHH는 Fable로 계획을 세우고 Opus 5로 구현한 뒤, Codex xHigh나 Grok으로 상호 검토하는 프런티어 모델 간 교차 검증 파이프라인을 권장한다.
개발 환경의 변화와 실무 도입 제약
에이전트 작업 환경으로서 Linux는 설정 파일, CLI 도구, 구체적인 오류 메시지라는 특성 덕분에 macOS나 Windows보다 유리하다. macOS는 GUI 기반의 수작업 설정과 500ms 단위의 애니메이션 등 사용자 통제 제약이 많고, Windows의 WSL은 샌드박스 구조로 인해 에이전트가 시스템 전체를 제어하는 데 한계가 있다. 반면 Linux의 난해한 오류 메시지는 에이전트가 학습된 코드와 연결해 진단하기 용이하며, 실제 Omarchy QA 과정에서 에이전트 8개가 12초 만에 28개의 이슈를 찾아내 등록하는 성능을 보였다.
대규모 조직의 경우 구현 능력보다 인간의 의사소통과 승인 구조가 병목으로 작용한다. Basecamp 5의 개발 사례에서 AI가 생성한 개별 PR은 타당해 보였으나, 이를 결합했을 때 시스템 아키텍처가 훼손되는 현상이 발생했다. 이는 제품 관리자, 디자이너, CTO 등 다수의 이해관계자가 관여하는 승인 체계가 에이전트의 가속 속도를 따라가지 못하는 '혁신가의 딜레마'로 분석된다.
실무자는 이제 코드를 직접 작성하는 '선수'에서 전체 형태와 복잡성을 판단하는 '코치' 또는 '편집자'로 역할을 전환해야 한다. 세부적인 지시보다는 높은 수준의 비전과 방향을 제공하고, 자동 테스트가 오류를 잡는 환경에서 "더 단순하게 만들라"는 식의 구조적 최적화에 집중하는 것이 에이전트 시대의 핵심 역량이다.




