AI 개발의 패러다임이 전문화, 비용 효율화, 그리고 협업 중심의 구조로 빠르게 전환되고 있다. 이번 주 주목할 모델은 V4 Pro 0813이다. 모바일과 웹 프로젝트에서 고성능 코딩 능력을 구현하면서도 비용 효율성을 극대화했다. 이제는 단순 성능 경쟁을 넘어 비용 효율의 시대다.
모델의 진화와 함께 ChatGPT Work 같은 워크스페이스 관리 도구도 팀의 일하는 방식을 바꾸고 있다. 경로 지도(routing maps)와 지속적인 행동 규칙을 도입해 복잡한 프로젝트를 체계적으로 관리하는 수준이 한층 정교해졌다.
시스템 통합이 가속화되면서 음성 AI의 현실적인 제약 사항도 핵심 과제로 떠올랐다. 개발자들은 오류를 최소화하기 위해 여러 모델을 단계적으로 연결하는 방식(cascading models)을 사용해, 응답 속도(latency)와 운영 비용 사이의 최적점을 찾는 데 집중하고 있다.
개별 도구의 성능을 넘어 자율형 AI들의 협업(multi-agent collaboration)은 복잡한 수학 문제 해결에서 유의미한 돌파구를 만들어내는 중이다. 동시에 많은 기업은 HighLevel 같은 플랫폼을 통해 AI 직원을 확장하며 그에 따른 재무적 현실을 조율하고 있다.
공개 가중치(open-weight) 코딩 모델을 위한 새로운 검증 장치(harness)의 등장부터, 현장 엔지니어들이 직접 수행하는 고객 데이터 성능 시험(evaluation)까지, 최근의 흐름은 명확하다. 실제 서비스 환경에서 예측 가능한 신뢰성과 체계적인 자율형 업무 흐름(agent workflows)을 구축하는 것이 핵심이다.
01DeepSeek V4 Pro 0813: 코딩 없이 완성하는 전문 앱
DeepSeek V4 Pro 0813이 지루한 코딩 과정을 자동화하며 전문 수준의 모바일 및 웹 앱 제작 문턱을 크게 낮췄다. 개발자는 이제 복잡한 로직과 세련된 인터페이스를 갖춘 앱을 거의 즉시 생성할 수 있다. 최근 시연에서 이 모델은 Flutter 프레임워크를 사용해 영화 선택 앱을 성공적으로 구축했다. 단순히 멈춰있는 페이지가 아니라, 실제 작동하는 스와이프 기능과 검색, 평점 기반의 정교한 필터링 로직까지 모두 구현했다. 라이트 모드와 다크 모드 전환 같은 심미적 디테일까지 챙겼다. 구조적 논리와 사용자 경험(UX) 설계의 균형을 잡았다는 증거다.
개발 방식의 변화가 속도를 더한다. 무작정 코드를 짜기보다 설계를 먼저 하는 방식이 도입됐다. 클로드 코드는 특정 명령어를 통해 '아트보드(artboards)'라 불리는 편집 가능한 시각적 옵션을 생성한다. 개발자는 단 한 줄의 코드를 쓰기 전에 페이지의 외형과 느낌을 확정할 수 있다. 비전에 맞지 않는 레이아웃을 짜느라 시간을 낭비하는 일이 사라진다. 구상부터 배포까지의 작업 흐름(workflow)이 훨씬 간결해졌다.
단순한 앱 제작을 넘어, 이제는 자율형 AI(AI agents)가 정해진 단계별 지침 없이 특수 환경에서 스스로 작동하는 시대로 가고 있다. Together AI의 제임스 조우(James Zou) 팀은 AI에게 적절한 인프라와 보상 체계를 제공하면 지능이 더 자연스럽게 발현된다고 주장한다. 이는 '아인슈타인 아레나(Einstein Arena)'에서 잘 드러난다. 이곳에서는 객관적인 수학적 점수를 매기는 자동 검증 장치(deterministic verifiers)를 통해 AI가 내놓은 해결책의 품질을 실시간으로 평가한다.
이러한 자율 시스템은 실제 생산 현장에서 이미 가시적인 성능 향상을 이끌어내고 있다. Together AI는 경쟁형 에이전트 환경을 구축해 AI 하드웨어를 구동하는 저수준 코드인 머신러닝 커널(ML kernels) 최적화를 자동화했다. 에이전트들이 서로 협력하고 결과물을 다듬게 한 결과, 기존 최신 커널보다 2배 이상의 속도 향상을 달성했다. 수동 코딩에서 자율형 최적화로의 전환이다. 덕분에 DeepSeek V4 Pro 0813 같은 모델이 만든 앱은 최적의 인프라 위에서 가장 효율적으로 구동된다.
02자율형 AI — 정해진 코드로 오작동을 잡다
자율형 AI(agent)는 자연어 명령이나 단편적인 API 호출에만 의존할 때 일관성이 떨어진다. 이를 해결하기 위해 실제 코드와 미리 정의된 스크립트를 작업 흐름(workflow)에 직접 통합하는 방식이 도입됐다. 실행 속도는 빨라지고 불필요한 실수는 줄어든다. 데이터 수집이나 분석, 개발 서버 구동 같은 복잡한 작업은 AI가 스스로 추론하게 두는 대신, 정해진 대로 움직이는 스크립트를 사용하는 것이 훨씬 정확하다. 추론보다 실행이 중요하다.
진정한 신뢰성은 단순히 작업을 잘게 쪼개는 것만으로 완성되지 않는다. AI가 자신의 결과물과 진행 상황을 스스로 검증할 도구를 갖춰야 한다. 일부 고도화된 시스템은 AI가 직접 자바스크립트(JavaScript)를 작성해 작업 흐름을 동적으로 설계한다. 다른 AI를 생성하거나 의존성 파이프라인을 정의하고, 병렬 실행 경로를 만드는 기본 구성 요소(primitives)를 활용해 작업에 딱 맞는 구조를 프로그래밍 방식으로 구축하는 식이다. 여기에 사용자가 만든 잘못된 설계 사례를 검토하는 '일일 나쁜 디자인 분류 기술(daily bad design triage skill)'을 더해 성능을 지속적으로 개선한다.
보안 장벽과 환각(hallucination) 같은 자동화의 취약점을 해결하는 것도 신뢰성의 핵심이다. 클로드(클로드)를 위한 1Password 연동 기능은 '자율 모드(agentic mode)'를 통해 로그인 화면에서의 실패 문제를 해결했다. AI가 1Password 금고에서 필요한 인증 정보를 요청하면, 사람이 이를 수동으로 승인하는 '인간 개입(human-in-the-loop)' 시스템을 적용했다. 1Password 확장 프로그램이 정보를 자동으로 입력하므로, AI 모델은 실제 비밀번호를 볼 수 없어 보안이 유지된다. 음성 AI 서비스 역시 단순하고 구체적인 프롬프트를 사용해 신뢰도를 높인다. 답을 모를 때는 억지로 지어내지 말고 "나중에 다시 전화를 드리겠다"고 안내하는 식의 명확한 예외 처리 지침을 제공한다. 거짓말보다 정직한 모름이 비용을 줄인다.
03ChatGPT Work, 반복 지시 없는 '나만의 업무 공간' 가능할까?
ChatGPT Work가 단순한 챗봇을 넘어 지속적인 워크스페이스 관리자로 진화했다. 이제 사용자는 새로운 대화를 시작할 때마다 똑같은 지시를 반복할 필요가 없다. `agents.md`라는 설정 파일이 일종의 '마스터 규칙서' 역할을 하기 때문이다. AI는 모든 작업을 수행하기 전, 평문으로 작성된 이 문서에서 글로벌 규칙, 글쓰기 스타일, 유지 관리 가이드라인을 먼저 읽는다. 회의 시간을 45분으로 고정하거나 결론부터 제시하는 '두괄식(bottom line up front)' 형식을 요구하는 등의 개인적 선호를 자동화할 수 있다. 세션이 바뀌어도 설정은 그대로 유지된다.
복잡한 프로젝트 관리를 위해 요청을 전용 하위 폴더로 연결하는 '라우팅 맵(routing maps)' 기능도 도입됐다. AI가 요청의 성격을 파악해 여행 취향 같은 특정 맥락이 담긴 폴더만 참조하게 함으로써 검색 효율을 높인 것이다. 또한 AI가 처리하는 텍스트 기본 단위인 토큰(token) 낭비를 막기 위해, 메인 파일인 `agents.md`는 가볍게 유지하고 앱별 세부 규칙은 `tool-conventions.md` 파일로 분리해 관리한다. AI 초안과 최종 수정본을 비교해 추출한 글쓰기 스타일까지 라이브러리화해 활용할 수 있다. 효율과 정교함을 동시에 잡은 구조다.
단순한 제안을 넘어 직접 실행하고 검증하는 단계로 나아갔다. Ghost 같은 호스팅 플랫폼과 연결하면 웹사이트에 다크 모드 토글을 실제로 구현하는 등 실시간 변경 사항을 즉시 적용할 수 있다. 인앱 브라우저를 통해 사용자 계정에 로그인해 반복적인 품질 보증(QA) 업무를 처리하는 것도 가능하다. 예를 들어 강의 설명에 포함된 모든 링크를 일일이 점검해 끊긴 링크를 찾아내는 작업이다. 특정 업무 흐름(workflow)을 위한 가이드라인을 미리 만들어두면, 별도의 설정 없이 즉시 '코딩 선생님 모드'를 실행해 상세한 코드 분석과 교육적 피드백을 받을 수 있다.
04음성 AI 설계의 진화 — 속도와 비용 사이의 정교한 균형
음성 AI가 회사의 반품 정책을 잊고 엉뚱한 답변을 내놓는 것은 전형적인 환각 현상이다. 거대언어모델(LLM)은 방대한 지침이 주어지면 앞뒤 4% 정도의 정보만 기억하고 중간 내용은 무시하는 경향이 있기 때문이다. 개발자들은 이런 오류를 막기 위해 긴 지침을 한 번에 입력하는 방식에서 벗어나, 필요한 정보만 골라 전달하는 정교한 작업 흐름(workflow)을 구축하고 있다.
제어 수준이 중요한 서비스에서는 음성 대 음성(speech-to-speech) 모델을 통째로 쓰기보다 단계별로 연결된 구조를 선호한다. 이 방식은 컨베이어 벨트처럼 작동한다. 사용자의 입력이 들어오면 감독 모델이 먼저 개입해 악의적인 프롬프트 주입이나 사회 공학적 공격을 걸러낸 뒤, AI가 의도를 파악하게 한다. 품질과 속도를 동시에 잡기 위해 여러 모델에 동시에 답변을 생성하게 한 뒤, 판단 모델이 가장 적절한 답을 골라내는 폭포수형 혹은 분기형 구조도 활용된다.
Hydra와 같은 최신 모델은 인간의 인지 방식을 모방해 비동기적으로 작동한다. 사용자의 말을 듣는 동시에 생각을 정리하거나 외부 도구를 호출할 수 있다는 의미다. Hydra는 다중 모달(multimodal) 모델로서 음성과 텍스트를 병렬로 처리하고 출력한다. 업계는 앞으로 음성 대 음성 모델이 일상적인 대화를 주도하고, 복잡한 질문은 여러 모델이 연결된 체인으로 넘겨 정밀하게 분석하는 하이브리드 방식이 주류가 될 것으로 본다.
운영 효율을 높이기 위해 프롬프트의 길이를 줄여 비용과 지연 시간을 낮추는 노력도 필수적이다. Vappy는 신용카드 정보 입력과 같이 복잡하고 단계가 많은 작업은 특화된 에이전트에게 맡긴다. 특정 목적이 달성된 뒤에야 다시 자유로운 대화 모드로 돌아오는 방식이다. Vapy는 지역별 발음 문제를 해결하기 위해 맞춤형 텍스트 음성 변환(TTS) 서버를 도입한다. 신뢰성을 확보하기 위해 개발자들은 AI 모델을 심판으로 세워 답변이 사실에 근거했는지, 추가적인 사전 처리가 필요한지를 반복적으로 검증한다.
05단일 AI의 한계, AI 팀워크가 뚫어낸 수학의 벽
세계에서 가장 복잡한 수학 난제를 푸는 방식이 바뀌고 있다. 이제는 모든 능력을 갖춘 단일 AI를 찾는 대신, AI들의 팀워크를 활용하는 전략이 핵심이다. 특정 고난도 문제는 모델의 크기나 학습량과 상관없이 단일 모델의 처리 능력을 넘어서기 때문이다. 대표적인 사례가 '접촉수 문제(kissing number problem)'다. 하나의 중심 구체 주위에 겹치지 않게 최대한 몇 개의 구체를 배치할 수 있는지를 묻는 기하학적 난제다. 단순한 공간에서는 쉬워 보이지만, 차원이 높아질수록 계산량은 기하급수적으로 늘어난다. 이제는 체급이 아니라 전략의 싸움이다.
낮은 차원에서는 답이 직관적이다. 1차원에서는 좌우로 하나씩, 총 2개가 답이다. 2차원에서는 6개가 된다. 하지만 11차원 접촉수 문제처럼 고차원으로 넘어가면 계산 난이도가 폭증한다. GPT 5.5나 클로드 같은 현존 최강의 단일 모델조차 이 문제를 스스로 풀지 못한다. 11차원 공간의 복잡성은 단순한 연산 능력이나 파라미터 숫자를 늘리는 것만으로는 넘을 수 없는 벽이다. 단일 모델의 지능에는 명확한 천장이 존재한다.
이 한계를 넘기 위해 연구자들은 다중 에이전트 협업(multi-agent collaboration)에 주목한다. 하나의 모델이 정답을 내놓길 기다리는 대신, 특화된 여러 AI 에이전트들이 네트워크를 이뤄 함께 작업하는 방식이다. 이들은 단순히 결과만 내놓지 않는다. 서로의 답안을 비판하고 수정하는 끊임없는 피드백 루프를 통해 최적의 해법을 찾아낸다. 이러한 협업 기반의 작업 흐름(workflow) 덕분에 단일 AI로는 불가능했던 수학적 돌파구가 열리고 있다. 인지적 부하를 분산하고 상호 검증 시스템을 구축함으로써, 가장 강력한 단독 모델조차 닿지 못했던 영역을 정복하고 있다. 개별 지능의 합보다 협업의 시너지가 더 강력하다.
06고객 접점 엔지니어: 실제 대화 데이터로 AI 출시 전 결함 차단
기업들은 제품을 공개하기 전, 실제 인간의 행동 패턴으로 테스트해 결함이 있는 AI 도구가 출시되는 상황을 막을 수 있다. 기술 개발과 고객 요구사항 사이의 간극을 메우는 전문가인 고객 접점 엔지니어(Forward Deployed Engineers)들이 실제 고객 대화 데이터를 활용해 성능 시험(evals) 기준을 만들고 있다. 이 성능 시험은 엄격한 품질 관리 계층 역할을 한다. 엔지니어들은 시스템이 가장 기본적인 작업에서 실패하지 않는지 확인하는 기본 작동 시험(smoke tests)을 통해, AI가 특정 업무 흐름(workflows)이나 대화 유형을 어떻게 처리하는지 공식 출시 전에 검증한다. 품질 관리가 곧 제품의 생존이다.
이 방식은 사용자가 실제로 어떤 상호작용을 할지 정확히 예측하게 해준다. 고객이 무엇을 물어볼지 추측하는 대신, 기존 데이터를 사용해 현실적인 테스트 환경을 구축하는 것이다. 이를 통해 AI의 응답이 실제 사용자 요구에 부합하는지, 그리고 예측 불가능한 실제 대화를 처리할 만큼 시스템이 견고한지 확인할 수 있다. 출시 전 검증은 매우 중요하다. 사용자나 기업 평판에 부정적인 영향을 주기 전에 AI의 논리적 결함이나 성능 문제를 미리 찾아낼 수 있기 때문이다. 추측이 아닌 데이터로 증명하는 단계다.
정확도를 넘어, 데이터 기반 테스트는 심각한 효율성 문제, 특히 대량의 정보를 처리할 때 발생하는 비용 문제를 드러낸다. AI 시스템이 너무 큰 프롬프트(모델에 제공하는 지침과 맥락의 집합)를 사용하면 응답 시간이 길어지고 전체 비용이 상승한다. 예를 들어 음성 AI의 경우, 많은 사용자가 통화 시작 10초 만에 전화를 끊기도 한다. 시스템이 이미 방대한 프롬프트를 처리했다면, 통화 성공 여부와 상관없이 기업은 해당 토큰 비용을 지불해야 한다. 이를 해결하기 위해 스티븐(Stephen) 같은 엔지니어들은 프롬프트를 분할해 지연 시간(latency)과 비용을 낮추는 방식을 제안한다. 똑똑한 AI보다 더 중요한 것은 효율적인 AI다.
07이름은 하나인데 하는 일은 셋 — '그래프 엔지니어'라는 모호한 이름표
최근 '그래프 엔지니어'라는 직함이 유행하며 AI 시스템을 구축하려는 기업과 개발자들 사이에 큰 혼란이 생겼다. 하나의 용어가 너무 넓은 범위를 포괄하다 보니, 같은 단어를 쓰면서도 서로 완전히 다른 세 가지 기술 구조를 이야기하는 경우가 허다하다. 정밀한 정의가 없으니 실질적인 전략 수립이 불가능하다. 실무 작업 흐름(workflow)에서 '그래프'가 정확히 무엇을 의미하는지에 대한 업계 합의가 없기 때문이다.
혼란의 핵심은 서로 다른 세 가지 개념이 뒤섞여 있다는 점이다. 첫째는 제어 그래프(control graph)다. 표준 운영 절차(SOP)를 강제해 AI가 일관된 결과를 내도록 만드는 엄격한 지도 역할을 하며, 시스템의 신뢰성을 확보하는 데 쓰인다. 둘째는 지식 그래프(knowledge graph)다. 서로 다른 정보 간의 관계를 연결해 AI가 정보를 기억하고 이해하게 만드는 일종의 장기 기억 장치다. 마지막으로 루프 그래프(graph of loops)가 있다. 이는 기업이 비즈니스 프로세스의 반복적인 주기(cycle)를 어떻게 관리하고 실행하는지에 집중하는 조직 운영 관점의 개념이다.
이런 용어의 충돌은 최근 소셜 미디어에서 '단순 반복(loop)에서 복잡한 그래프로 중심축이 이동하고 있는가'를 두고 벌어진 논쟁에서 극명하게 드러났다. 전문가가 '그래프'로의 전환을 말할 때, 위 세 가지 구조적 변화 중 무엇을 뜻하는지 알 수 없다는 뜻이다. 이는 채용 시장에서 실질적인 리스크가 된다. 데이터 관계와 기억 전문가를 뽑으려 '그래프 엔지니어'를 채용했는데, 막상 들어온 사람은 프로세스 신뢰성이나 업무 흐름 전문가일 수 있다. 용어의 구분이 명확해지기 전까지 이 직함은 전문 기술 영역이 아닌 모호한 유행어에 불과하다. AI 팀을 구성하고 확장하는 방식에 혼선을 주는 요소다.
08AI 소프트웨어 제작의 문턱이 낮아졌다 — 서버 구축 없는 간편 배포 환경
이제 개발자와 기업은 거대한 서버 장비를 구매하거나 복잡한 기술 설정을 위해 수많은 시간을 허비할 필요가 없다. Client가 제공하는 관리형 환경, 즉 검증 및 배포 장치(deployment harness)가 고성능 도구의 진입 장벽을 없앴기 때문이다. 내부 파라미터가 공개된 오픈 웨이트(open-weight) 모델을 활용하려면 그동안 막대한 비용과 기술적 인프라가 필수였다. 이제는 Client가 인프라 최적화를 대신 처리한다. 비용과 기술적 부담이 사라졌다.
이 관리형 환경은 모델을 실제 서비스 단계에 적용하는 과정을 획기적으로 단순화했다. 개별 API를 일일이 관리하거나 고가의 GPU를 직접 구매하는 대신, 모델 성능을 최대로 끌어올릴 수 있도록 설계된 간소화된 설정만 이용하면 된다. Kimi 모델이 대표적인 사례다. 이 배포 장치를 통해 작동하는 Kimi는 단순한 코드 추천 수준을 넘어선다. 프로젝트의 각 부분을 동시에 처리하는 소규모 전문 AI 단위인 하위 에이전트(sub-agents)를 스스로 배치해 복잡한 과업을 자율적으로 수행한다.
결과적으로 프롬프트 한 줄만으로 완전히 작동하는 소프트웨어 애플리케이션을 만들 수 있게 됐다. 최근 Kimi 모델은 사용자 화면(front end)부터 저장소, 데이터베이스 시스템까지 모두 포함된 완성형 소프트웨어 제품을 구축하는 능력을 증명했다. 단순한 코드 조각을 생성하던 수준에서 실제 작동하는 소프트웨어를 만드는 단계로 진화한 것이다. 배포와 최적화라는 무거운 짐을 Client가 짊어지면서, 이제 핵심은 '어떻게 설치하느냐'가 아니라 '결과물의 품질이 어떠한가'로 옮겨갔다. 단순한 시각적 프로토타입이 아닌, 즉시 사용 가능한 수준의 소프트웨어가 탄생한다.
09AI 직원 늘리면 비용도 정비례? HighLevel의 수익 구조는 안전한가?
HighLevel을 통해 AI 서비스를 확장하려면 치밀한 가격 전략이 필요하다. 시스템에 고객이 추가될 때마다 운영 비용이 선형적으로 증가하는 구조이기 때문이다. 플랫폼 자체는 AI 직원의 배포 과정을 단순화했지만, 그 이면에는 계정당 과금 체계가 자리 잡고 있다. 이 비용은 자칫 에이전시의 기본 구독료를 쉽게 추월한다. 사업자 입장에서 'AI 직원 무제한 플랜'의 무제한은 단일 하위 계정 내의 작업량에만 해당할 뿐, 고객사가 늘어날수록 전체 지출은 계속해서 상승한다. 비용 관리가 곧 수익성이다.
실제 지출 규모를 따져보면 재무적 부담은 더 구체적이다. AI 직원 무제한 플랜은 하위 계정(sub-account) 하나당 약 97달러의 비용이 발생한다. 고객사 10곳을 관리한다면 AI 이용료만 매달 약 970달러를 지불해야 한다. 이는 497달러 수준인 Agency Pro 플랜의 기본 구독료와는 완전히 별개로 청구되는 금액이다. AI 이용료가 핵심 서비스 구독료를 넘어서는 상황이 빈번하므로, 서비스 제공자는 마진 잠식을 막기 위해 이 반복 비용을 고객 단가에 반드시 반영해야 한다. 배보다 배꼽이 더 큰 상황이다.
비용 부담에도 불구하고 HighLevel이 가진 강점은 반복 가능한 서비스 구축 인프라에 있다. 설정이 완료된 AI 직원을 템플릿 형태로 저장해 새 고객 계정에 즉시 적용하는 '스냅샷(snapshots)' 기능이 핵심이다. 이를 통해 신속한 배포가 가능하며, 업데이트 사항을 모든 고객사로 빠르게 전파할 수 있다. 여기에 고객 관계 관리 시스템(CRM), 하위 계정 관리, 사용료를 고객에게 다시 청구하는 재청구(rebilling) 기능까지 결합되어 종합 관리 환경을 제공한다. HighLevel의 음성 엔진이 시장에서 가장 저렴하지는 않지만, 개별 음성 API를 사용할 때보다 훨씬 효율적인 업무 흐름(workflow)을 보장한다.
10클로드 코드 /design, '일단 짜보고 수정'하던 UI 개발의 비효율 제거
AI로 사용자 인터페이스(UI)를 디자인하는 과정은 그동안 시행착오의 연속이었다. 결과물을 보지 못한 채 명령어를 입력하는 '맹목적 프롬프팅(blind prompting)' 방식 때문이다. 보통은 AI가 코드를 다 짠 후에야 헤더 크기를 키워달라는 식의 수정을 요청한다. 보이지 않는 디자인을 상상하며 설명해야 하니, 만들고 고치는 비효율적인 순환이 반복된다. 클로드 코드가 도입한 '/design' 명령어는 이 순서를 완전히 뒤집었다. 코드를 바로 짜는 대신, 수정 가능한 여러 디자인 시안이 담긴 아트보드를 먼저 생성한다. 시각적 결정과 확정을 코딩 단계보다 앞세워, 초기 단계의 추측성 작업을 없앴다.
이 기능을 제대로 쓰려면 전문 디자이너와 협업하는 것처럼 구체적으로 요청해야 한다. 모호한 지시 대신 페이지의 타겟 독자와 인터페이스의 핵심 목적 같은 엄격한 제약 조건을 제시해야 한다. 선호하는 스타일의 예시를 함께 주면 AI가 뻔한 결과물을 내놓는 것을 막을 수 있다. 특히 최소 세 가지 이상의 서로 다른 디자인 방향을 요구하는 것이 핵심이다. 단 하나의 해석에 의존하지 않고 여러 구조적 접근 방식을 비교해 최적의 안을 선택할 수 있기 때문이다.
도구 선택은 프로젝트의 최종 결과물에 따라 달라진다. 실제 작동하는 앱이나 웹페이지를 만드는 것이 목표라면 개발 환경에 디자인이 통합된 클로드 코드가 가장 효율적이다. 반면 포스터, 전단지, SNS 그래픽처럼 코드가 필요 없는 시각 자료는 일반 클로드 앱이 적합하다. 현재 리서치 프리뷰 단계지만, 이는 디자인 작업 흐름의 중대한 변화를 의미한다. 시각적 개념 구상과 기술적 구현을 분리함으로써, 훨씬 정교하고 의도적인 반복 수정이 가능해졌다.
11HighLevel 요금제의 격차 — 단순 비용 청구와 수익 창출의 갈림길
HighLevel로 AI 서비스를 배포하는 대행사 운영자들에게 요금제 선택은 단순한 비용 문제가 아니다. 사업으로 돈을 벌 것인지, 아니면 취미 생활에 그칠 것인지를 결정하는 생존의 문제다. AI 사용료에 마진(markup)을 붙여 수익을 내는 기능이 특정 요금제에만 묶여 있기 때문이다. 적절한 플랜을 쓰지 않으면, 대행사는 AI 사용 비용을 고객에게 그대로 청구할 뿐 정작 자신들의 몫은 단 한 푼도 챙길 수 없다.
핵심은 297달러 플랜과 497달러 Agency Pro 플랜의 차이다. 297달러 요금제에서는 비용 그대로 청구(cost pass-through) 모델만 가능하다. 즉, AI 사용료가 발생한 만큼만 고객에게 청구할 수 있다. 반면, 도매가로 AI를 쓰고 고객에게는 더 높은 가격을 책정해 그 차액을 남기는 재청구(rebilling) 전략을 쓰려면 반드시 Agency Pro 플랜으로 업그레이드해야 한다. 이 요금제 장벽이 대행사의 마진을 결정하는 문지기 역할을 한다.
AI 음성 에이전트의 경제성을 따져보면 이 차이는 더욱 극명해진다. 보통 AI 음성 서비스는 선택한 모델과 목소리에 따라 분당 7~23센트의 비용이 든다. 하지만 시장에서 형성된 AI 리셉셔니스트의 단가는 분당 25~48센트 수준이다. 이 사이의 간극이 곧 대행사의 핵심 수익원이 된다. 특히 HighLevel이 지난 5월 고정 단가제를 폐지하면서 과거의 가격 계산기는 무용지물이 됐다. 이제는 변동 비용을 어떻게 관리하느냐가 수익의 핵심이다.
결국 대행사가 제공하는 가치는 AI 기술 그 자체가 아니라, 기술 위에 얹어진 운영 관리 능력에 있다. Agency Pro 플랜을 통해 AI 원가와 시장 가치 사이의 마진을 확보해야 사업이 성립한다. 이 요금제를 쓰지 않는다면 차액을 남기는 구조 자체가 불가능하다. AI 음성 서비스 사업에서 수익 엔진을 떼어내는 것과 같다.
12Einstein Arena: 인간의 가이드 없이 AI가 스스로 과학을 연구하는 공간
인간이 AI를 다루는 방식이 엄격한 관리에서 자유로운 탐색으로 이동하고 있다. 기존에는 자율형 AI(에이전트)를 활용하려면 정해진 작업 흐름(workflow)을 설계해야 했다. 프롬프트와 도구, 지침을 순서대로 배치해 기계의 행동을 일일이 지정하는 방식이다. 하지만 이런 접근은 AI를 미리 정해진 경로에 가두는 결과를 낳았다. 설계된 경로가 AI의 한계가 되었다. 이를 깨기 위해 등장한 것이 '아인슈타인 아레나(Einstein Arena)'다. AI가 독립적으로 작동하며, 개방형 과학 문제를 해결하기 위해 서로 협력하고 경쟁하는 시스템이다.
이 환경은 '자율형 AI 전용(agent-native)'으로 설계됐다. 사람 사용자가 아닌 AI의 필요에 최적화했다는 의미다. 특히 인간의 개입을 막기 위해 진입 장벽을 의도적으로 높였다. 접속하려는 대상은 먼저 퍼즐을 풀어 자신이 AI임을 증명해야 한다. 사람이 들어오기 어렵게 만들어, AI들이 인간의 단계별 가이드 없이 '야생'의 상태에서 서로 상호작용하며 협력하는 독특한 공간을 구축했다. 인간을 배제해 AI만의 자율성을 확보했다.
Together AI와 스탠퍼드 대학이 공동 개발한 아인슈타인 아레나는 AI를 통한 발견의 접근 방식을 근본적으로 바꾼다. AI를 매뉴얼을 따르는 도구가 아니라, 과학적 프로세스의 능동적인 참여자로 취급한다. 개방형 연구 방식을 모방해 AI들이 상호작용하며 완전히 새로운 과학적 발견을 이끌어내는 것이 목표다. 기존의 경직된 작업 흐름을 제거함으로써 AI는 스스로 실험하고 조율할 수 있게 됐다. 도구의 시대가 가고 주체의 시대가 왔다. 복잡한 과학 분야의 혁신 속도가 비약적으로 빨라질 전망이다.
