Claude Managed Agents에 「Dreaming」기능 — 세션 간 실패 패턴 자동 수정
機械翻訳 / Machine-translated
機械翻訳 / Machine-translated
Anthropic이 2026년 5월 6일, Managed Agents를 위한 새로운 기능 「Dreaming(드리밍)」을 연구 프리뷰로 공개했다. 에이전트가 세션과 세션 사이에 과거 행동 로그를 자율적으로 검토하고, 반복적으로 발생하는 실수를 감지해 다음 세션부터 이를 회피하는 설계다. 인간이 피드백을 제공하지 않아도 에이전트 스스로 「경험으로부터 배우는」 구조는, 현행 스테이트리스 AI 에이전트 설계에서 한 발 더 나아간 것이라 할 수 있다.
Anthropic은 5월 6일자 공식 발표에서, Claude Managed Agents에 「Dreaming」이라는 이름의 세션 간 리뷰 메커니즘을 추가했다고 밝혔다.
기능의 골격은 다음과 같다.
X에서는 빠르게 반응이 나오고 있다.
Anthropic이 5/6에 릴리스한 새 기능(연구 프리뷰). Managed Agents가 세션 사이에 「꿈을 꾸듯」, 과거의 경험을 자동으로 리뷰해 줍니다. 반복되는 실수를 발견해 회피…
현 시점에서는 「연구 프리뷰」 단계이며, 프로덕션 환경에 대한 일반 제공 일정은 미공표 상태다.
현행 LLM 기반 에이전트는 원칙적으로 스테이트리스다. 세션을 넘나드는 기억 유지는 벡터 DB나 외부 스토리지에 의존하며, 「무엇을 실수했는가」의 자율적인 축적은 개발자 측의 구현에 맡겨져 있었다.
이 과제에 대해 각 사는 서로 다른 접근법을 취해 왔다. OpenAI는 Custom Instructions와 메모리 기능으로 사용자 계층의 연속성을 확보하고, Google은 긴 컨텍스트 윈도우(Gemini 1.5 Pro에서 100만 토큰)로 단일 세션 내 정보 보유량을 늘리는 방향으로 승부해 왔다.
Anthropic의 「Dreaming」은 이와는 다른 축을 취한다. 사용자가 제공하는 정보가 아니라, 에이전트 자신의 행동 로그에서 추출한 실패 패턴을 피드백 루프에 포함시키는 점이 특징이다. 「꿈을 꾼다」는 명칭은 인간의 수면 중 기억 정착 프로세스에서 착안한 것으로 보인다.
공개된 정보 범위 내에서는, 어느 수준의 실패를 「반복적인 실수」로 판정하는지의 로직은 비공개다. 도구 호출 실패인지, 논리적 판단의 오류인지에 따라 실용적인 효과는 크게 달라진다.
에이전트가 자율적으로 내부 상태를 수정하는 설계는, 디버깅과 추적 가능성 측면에서 리스크를 수반한다. 연구 프리뷰 단계에서 무엇을 관찰 대상으로 삼고 있는지에 주목할 필요가 있다.
OpenAI는 Agents SDK에서 장기 메모리의 API화를 진행하고, Google은 Agent Space에서 조직 내 지식과의 통합을 추진하고 있다. Anthropic이 「세션 간 자율 학습」을 선행 공개함으로써, 에이전트의 「개선 사이클」이 어디에 구현되는가라는 경쟁 축이 명확해졌다.
Anthropic이 연구 프리뷰로 공개하는 것은, 내부 평가가 일정 수준에 도달한 기능인 경우가 많다. 2025년에 연구 프리뷰로 공개된 Extended Thinking은, 이후 3개월 이내에 프로덕션 제공으로 이행한 실적이 있다.
반복 업무를 자동화하는 RPA적 유스케이스에서, 오류 자동 수정은 도입 장벽을 낮추는 직접적인 요인이 된다. Claude for Work를 도입한 기업이 가장 먼저 혜택을 받을 것으로 보인다.
「에이전트가 꿈을 꾼다」는 표현은 시적이지만, 기술적 함의는 구체적이다. 현재 에이전트 AI의 실운용 비용의 상당 부분은, 같은 실수를 반복하는 에이전트에 대한 인적 개입에 소모되고 있다. 만약 Dreaming이 실제로 기능한다면, 에이전트 운용의 「모니터링 비용」이라는 숨겨진 변수를 압축할 가능성이 있다.
한편, 자율 개선은 자율적인 오학습의 리스크도 내포한다. 연구 프리뷰 단계에서 제어 인터페이스를 어디까지 공개하느냐가, 실용화로의 분기점이 될 것으로 보인다.
Anthropic은 2026년 들어, Claude Code SDK의 월별 크레딧 분리(6월 15일 시작)나 Keyless 인증 도입 등, 엔터프라이즈를 위한 제어·과금 설계를 잇달아 강화하고 있다. Dreaming은 그 맥락 위에 있다. 「사용하기 쉬움」에서 「관리하기 쉬움」으로, Anthropic의 설계 철학의 무게 중심이 이동하고 있는 것처럼 보인다.
Anthropic의 「Dreaming」은, AI 에이전트의 자율 개선 사이클을 설계 차원에서 내재화한 최초의 구현 사례로 자리매김된다. 연구 프리뷰를 거쳐 프로덕션 제공에 이르면, 에이전트 운용 비용의 계산식이 달라질 가능성이 있다. 일반 제공 타임라인, 제어 API의 공개 범위, 그리고 타사가 어떻게 뒤따르는가 — 이 세 가지가 다음 관찰 축이 된다.
※본 기사는 미라이 뉴스 편집부의 AI 라이터(AI 뉴스)가 작성하였습니다.