LLM 애플리케이션 개발 시 세웠던 가정이 무너집니다. 모델의 한계를 보완하기 위해 겹겹이 쌓아 올린 장치들이 오히려 시스템을 무겁게 만듭니다. 어제의 보조 프레임워크가 오늘의 블로트웨어 로 변합니다.

모델 성장이 초래한 하네스의 만료

LLM 성능이 빠르게 향상되면서 기존 프레임워크의 수명도 줄었습니다. 불과 몇 달 전에는 모델이 계획을 쪼개지 못하거나 스스로 검증하지 못해 외부 에이전트와 루프를 복잡하게 연결해야 했습니다. 이제는 모델이 스스로 계획하고 검증합니다. 중복은 낭비입니다.

굳이 무거운 하네스 로 같은 작업을 반복할 필요가 없습니다. 얇고 직관적인 런타임이 주목받는 이유입니다.

스스로 검증하고 추적하는 경량 루프

최근 엔지니어들이 공개한 세 가지 경량 프로젝트는 얇고 명확한 설계 방향을 보여줍니다. lazycodex 는 굳이 코드를 건드리지 않고 계획 파일만 생성해 스스로 검증할 때까지 루프를 돕니다. gajae-code 는 불필요한 도구 모음을 배제하고 심층 인터뷰와 계획 비판만으로 구성된 단순한 순환 구조를 취합니다.

마지막으로 roach-pi 는 기존 코딩 에이전트에 목표 계약서 작성과 검증기 통과 추적 기능을 더해 단순하게 구성했습니다. 이 프로젝트들은 정교한 기능을 프레임워크에 가두지 않고 모델의 자연스러운 실행력에 의존합니다.

워크플로우에 맞는 에이전트 자작

정답을 미리 규정하는 거대한 프레임워크보다 개발자 자신의 작업 흐름에 맞춘 작은 하네스 를 직접 설계하는 편이 유리합니다. 모델이 진화할수록 두꺼운 추상화 레이어는 무용지물이 됩니다. 직접 루프를 설계하고 도구를 연결해야 환경에 맞는 생산성을 확보합니다.

스스로 도구를 만드는 개발자만이 환경에 최적화된 결과물을 얻습니다. 가장 가벼운 제어 구조를 고민하며 고유한 도구를 직접 만듭니다.

요약

  • LLM 자체 성능이 개선됨에 따라 이전의 복잡한 에이전트 통제 프레임워크(하네스)는 중복 동작을 유발하는 블로트웨어로 전락합니다.
  • 최근 트렌드는 프레임워크의 추상화 레이어를 걷어내고 필요한 최소한의 검증 루프만 실행하는 얇고 가벼운 커스텀 런타임 설계입니다.
  • 정형화된 개발 프레임워크에 의존하기보다 자신의 워크플로우에 특화된 경량 에이전트를 직접 깎아 쓰는 방식이 실질적인 생산성을 제공합니다.