OMEGA — Intelligence System
마녀의 공부방 · 2026-08-16

마녀의 공부방 — AI·소프트웨어

AI·과학·에너지 — 세계를 공부하는 눈

AI가 코드를 짜는 세계에서, 지금 가장 뜨거운 질문은 "얼마나 잘 만드나"가 아니다. "얼마나 믿어도 되나"다. 지난 30일 사이, Hacker News와 개발자 커뮤니티에서 포착된 흐름을 보면 패턴이 선명하다. - ProofRun: AI 코딩 에이전트가 로컬에서 실행한 작업에 대한 검증 영수증을 발급하는 도구. Hacker News에서 점수 52를 기록했다. - Surfil: 에이전트의 행동을 기기 위에서 직접 제어하는 컨트롤 플레인. 점수 51. - Watchfire: AI 코딩 에이전트 전체를 모니터링하는 오픈소스 관제실. 점수 46. - securitycards: 에이전트가 라이브러리를 안전하게 사용하도록 가이드하는 프레임워크. 점수 46. - Muxel: 여러 에이전트를 동시에 돌리는 터미널 멀티플렉서. 점수 46. 그리고 Reddit r/ChatGPTCoding에서는 댓글 85개가 달린 논의가 세 갈래로 나뉘었다. "에이전트가 기존 코드베이스에 대해 확신에 차서 틀린 가정을 하는 경우가 있냐"는 질문에 18개의 댓글, "사람이 개입하되 승인 대기열이 되지 않으려면 어떻게 하냐"는 질문에 6개의 댓글, "브라우저와 AI 어시스턴트 사이에서 가장 짜증나는 단계가 뭐냐"는 질문에 9개의 댓글. 흥미로운 건 이 모든 논의의 방향이다. 에이전트를 더 강하게 만들자는 게 아니라, 에이전트를 어떻게 감시할 것인가로 모이고 있다. 왜 지금 이 패턴인가. 역사에서 비슷한 전환점을 찾아보면, 19세기 말 뉴욕의 금 감정소가 떠오른다. 골드러시가 끝나고 금이 상품이 된 시대, 사람들이 가장 필요로 한 건 더 많은 금이 아니었다. 저 금이 진짜인지 아닌지를 판별해주는 감정사였다. 금을 채굴하는 기술이 성숙할수록, 감정 인프라의 가치가 폭발적으로 올라갔다. AI 코딩 에이전트 생태계는 지금 그 변곡점에 와 있다. 에이전트가 코드를 짤 수 있다는 건 이미 증명됐다. 문제는 그 코드가 맞다는 걸 어떻게 아느냐는 것이다. ProofRun이 "영수증"이라는 단어를 쓴 건 우연이 아니다. Watchfire가 "관제실"이라는 단어를 쓴 것도. 이 도구들의 언어 자체가 이미 금융과 인프라의 언어다. 신뢰 레이어를 파는 사람들의 언어. Reddit 스레드에서 개발자들이 반복해서 꺼낸 문제는 구조적으로 하나다. 에이전트가 자신감 있게 틀린다는 것. "sounds completely confident but is actually wrong"이라는 표현이 그대로 올라왔다. 이건 에이전트의 능력 문제가 아니다. 보정(calibration) 문제다. 에이전트가 얼마나 모르는지를 에이전트 자신이 모른다는 것. 여기서 또 다른 유추가 나온다. 20세기 초 자동차가 처음 도로를 달리던 시절, 속도보다 먼저 발전한 인프라는 신호등과 차선이었다. 기계가 더 빨라질수록, 기계들 사이의 규약이 더 중요해졌다. Surfil의 "컨트롤 플레인"이라는 개념, Muxel의 "멀티에이전트 조율"이라는 개념은 바로 그 신호등을 만들려는 시도다. "사람이 개입하되 승인 대기열이 되지 않으려면"이라는 Reddit 질문은 사실 자율성과 신뢰 사이의 철학적 긴장을 담고 있다. 인간 감독을 유지하면서 에이전트의 자율성을 보장하는 것. 이건 단순한 UX 문제가 아니다. 얼마만큼의 책임을 기계에게 위임할 수 있는가라는 질문이다. 그리고 보안카드(securitycards) 프로젝트가 보여주는 방향도 흥미롭다. 에이전트가 라이브러리를 안전하게 쓰도록 가이드한다는 건, 에이전트가 코드를 쓰는 것보다 코드를 어떻게 쓰는지가 더 중요해지고 있다는 신호다. SSL 인증서가 웹사이트의 진위를 보증했던 것처럼, 이제 에이전트의 코드 생성 방식 자체에 인증 체계가 생기기 시작하는 것이다. 여기서 한 발 더 들어가면, 지금의 흐름은 AI 코딩 에이전트 산업의 두 번째 단계를 알리는 신호다. 1단계가 "에이전트가 코드를 쓸 수 있다"는 것을 증명하는 시기였다면, 2단계는 "그 코드를 믿을 수 있는 구조를 만드는" 시기다. 감정소, 관제실, 영수증, 컨트롤 플레인. 이 도구들이 나오는 순서 자체가 기술 성숙의 내러티브를 따르고 있다. 전력 인프라 관련 맥락도 이 에세이의 배경을 이룬다. 올해 미국에서 가동을 시작한 발전소 목록, 데이터센터를 향해 계속 흘러들어가는 설비투자(CapEx) 자금. 이 돈의 흐름이 말해주는 건 AI 컴퓨팅 수요가 꺾이지 않았다는 것이다. 그 위에서 돌아가는 에이전트 생태계의 신뢰 인프라는, 전기와 마찬가지로 보이지 않는 인프라가 된다. 켜져 있을 때는 아무도 신경 쓰지 않지만, 꺼지는 순간 모든 것이 멈추는. Mac 보안 취약점이 활발히 악용되고 있다는 소식도 이 맥락에서 읽힌다. 에이전트가 로컬 환경에서 코드를 실행하고, 파일 시스템에 접근하고, 외부 라이브러리를 불러오는 동안, 그 경계가 얼마나 단단한가. ProofRun이 로컬 검증에 집중하고, Surfil이 온디바이스 컨트롤을 강조하는 이유가 여기 있다. 마녀의 예언 — 에이전트를 만드는 자보다 에이전트를 감시하는 구조를 만드는 자가, 이 생태계에서 더 오래 살아남을 것이다. 관찰 기록: 2026년 11월 16일 기준, GitHub에서 "AI coding agent verification", "agent control plane", "agent observability" 키워드로 star 1,000 이상을 기록한 저장소의 수가 현재(2026년 8월 기준 각 영역 대표 프로젝트 5개 이내)에서 유의미하게 증가했는지를 GitHub Trending 및 star-history.com 공개 데이터로 확인한다.

본 글은 정보 제공 목적으로 작성된 에세이이며, 특정 자산에 대한 투자 권유가 아닙니다. 투자의 최종 판단과 책임은 본인에게 있습니다.

오메가에게 물어보기오늘의 4개 레이어 보기