OpenAI가 최신 모델 GPT 5.6 Sol 라인업과 함께 데스크톱 앱을 대대적으로 개편했습니다. Anthropic이 Claude Fable 5 와 Cowork 기능으로 선점하던 데스크톱 에이전트 영역에 정면 도전장을 던졌습니다. 경쟁이 치열합니다. 채팅창을 넘어 데스크톱과 웹 배포 환경에서 벌어지는 두 빅테크의 구도를 정리했습니다.

데스크톱 앱 개편과 에이전트 전면 배치

OpenAI는 기존 Codex 앱을 ChatGPT 앱으로 통합하고 업무용 에이전트 기능인 Work 를 전면에 내세웠습니다. 기존 ChatGPT 앱은 ChatGPT Classic으로 이름을 변경하며 단순 채팅 기능으로 밀려났습니다. 변화가 급격합니다. 데스크톱 OS 환경 전체를 작업 공간으로 점유하려는 움직임으로 해석됩니다. 이번 개편은 이용자들이 앱 하나에서 업무와 개발이라는 두 가지 축을 한 번에 제어하도록 돕습니다.

Anthropic은 이미 올해 초부터 데스크톱 앱에 Cowork 을 출시하며 앞서갔습니다. 최근에는 클라우드 실행 환경을 지원해 사용자 PC가 꺼져도 작업을 지속하는 구조를 만들었습니다. 두 서비스는 차이가 있습니다. OpenAI가 이번에 발표한 Work 기능 역시 클라우드 실행을 기본 탑재하며 Anthropic이 다져온 6개월의 격차를 단숨에 좁혔습니다. 모바일과 웹 확장성까지 고려한 에이전트 환경 구축 경쟁은 더욱 가속화될 전망입니다.

모델 성능과 효율 비교

두 진영의 최상위 모델인 GPT 5.6 Sol 과 Claude Fable 5 는 서로 다른 강점을 보여줍니다. 에이전트 코딩 성능을 측정하는 SWE-bench Pro 지표에서는 Claude Fable 5 가 80.3%를 기록하며 우위를 차지했습니다. 반면 GPT 5.6 Sol 은 64.6%를 기록했습니다. 격차가 제법 큽니다. Anthropic 진영은 Fable 5 외에도 Opus 4.8과 Sonnet 5를 촘촘하게 배치하여 개발자 층을 공략합니다.

대신 GPT 5.6 Sol 은 토큰 효율과 비용에서 경쟁력이 뛰어납니다. 웹 에이전트 성능 지표인 BrowseComp에서 90.4%를 기록했으며 에이전트 코딩 토큰 효율을 54% 개선했습니다. 가격도 저렴합니다. Sol 의 API 가격은 100만 토큰 입력 기준 5달러로, 10달러인 Fable 5 의 절반 수준입니다. 성능당 비용을 고려하는 기업 환경에서는 선택 기준이 까다로워집니다.

웹 배포 기능 비교

OpenAI가 새로 선보인 Sites 기능은 채팅창에서 즉시 웹사이트를 제작하고 호스팅 도메인에 배포하는 기술입니다. 이 기능은 Anthropic의 Artifacts 와 지향점이 다릅니다. 목적이 다릅니다. Artifacts 가 협업을 위한 대시보드나 트래커 같은 라이브 자산에 집중한다면, Sites 는 외부 공개용 웹 배포를 지향합니다. 사용자가 원하는 웹 구조를 자연어로 설명하면 호스팅 도메인에 즉각 반영되는 방식입니다.

두 기능은 결과물의 완성도와 제작 시간에서도 뚜렷한 대조를 이룹니다. Sites 는 멀티 페이지 구조를 갖춘 완전한 웹사이트를 생성하지만 작업 시간이 약 40분으로 긴 편입니다. 반면 Artifacts 는 10분 내외의 짧은 시간에 단일 페이지 형태의 도구를 완성합니다. 선택 기준은 명확합니다. 사용 목적이 사내 공유용 대시보드인지, 아니면 외부 공개용 웹사이트인지에 따라 쓰임새가 완전히 갈립니다.

이제 AI 에이전트는 화면 안의 챗봇에 머무르지 않고 실제 결과물을 배포하는 단계로 진입했습니다. 여러분의 업무 데스크톱에는 어떤 에이전트가 먼저 자리 잡을지 기대됩니다.

요약

  • 데스크톱 앱 개편을 통해 단순 채팅창을 넘어 사용자의 실제 작업 공간(OS)을 선점하려는 에이전트 경쟁이 본격화되었습니다.
  • Claude Fable 5는 코딩 성능(SWE-bench Pro)에서 우위를 점한 반면, GPT 5.6 Sol은 높은 토큰 효율과 저렴한 비용으로 맞서고 있습니다.
  • 웹 배포 기능인 Sites와 Artifacts는 각각 공개 웹 배포와 협업용 라이브 자산 공유라는 서로 다른 목적성을 지향합니다.