Hooks와 Joule: 엔터프라이즈 에이전트에 컨트롤 플레인 등장

--- title: Hooks와 Joule: 엔터프라이즈 에이전트에 컨트롤 플레인 등장 slug: hooks-and-joule-enterprise-agents-get-a-control-plane meta_title: 엔터프라이즈 에이전트에 컨트롤 플레인 등장 meta_description: Microsoft는 Copilot Studio에 Hooks를 추가해 워크플로가 에이전트의 판단이 아닌 이벤트에 따라 실행되도록 했고, SAP는 Joule을 거버넌스가 적용된 에이전트 작업 계층으로 밀어 넣었습니다. category: ai tags: Microsoft Copilot Studio,Hooks,SAP Joule,에이전트 거버넌스,결정론적 가드레일,엔터프라이즈 AI,워크플로 자동화,컨트롤 플레인 ---
Microsoft와 SAP는 이번 달 며칠 간격을 두고 에이전트 기능을 출시했으며, 두 릴리스는 같은 점을 인정합니다. 비즈니스 워크플로의 시작 여부를 모델이 결정하게 하는 것은 안정성 리스크입니다.
Microsoft의 Hooks가 하는 일
Microsoft는 Hooks라는 Copilot Studio 기능을 프리뷰 중입니다. 이 기능은 에이전트가 해야 한다고 판단할 때만이 아니라, 어떤 일이 발생하면 에이전트 워크플로를 자동으로 실행합니다. 훅은 두 부분으로 구성됩니다. 에이전트 수명 주기가 내보내는 이벤트와, 해당 이벤트가 발생할 때 실행되는 액션입니다. 이벤트가 트리거되면 Copilot Studio는 바인딩된 워크플로를 호출하고, 무슨 일이 있었는지에 대한 세부 정보를 전달하며, 워크플로 응답을 다시 대화로 읽어들입니다.
도구와의 차이가 핵심입니다. 도구는 에이전트가 관련 있다고 판단할 때 실행됩니다. 훅은 이벤트가 발생할 때마다 실행됩니다.
Microsoft는 네 가지 시나리오를 제시합니다. 대화가 시작되기 전에 열린 지원 케이스를 조회해 세션 시작 시 컨텍스트를 추가합니다. 도구가 실행되기 전에 검사하고 비즈니스 규칙을 위반하면 액션을 차단합니다. 민감한 데이터를 삭제하거나 감사 기록을 작성해 도구의 결과를 후처리합니다. 에이전트에게 재시도, 건너뛰기 또는 중단을 지시해 실패를 처리합니다.
주의사항은 기능만큼이나 많은 정보를 줍니다. 훅은 특정 에이전트에 연결되며, 훅을 추가해도 그 아래의 워크플로는 바뀌지 않습니다. 훅이 실패해도 에이전트를 중지하지 않습니다. 워크플로가 타임아웃되거나 읽을 수 없는 값을 반환하면, 에이전트는 훅이 아무것도 반환하지 않은 것처럼 계속 진행합니다. 워크플로가 게시되어 있어야 하며, 그렇지 않으면 실행되지 않습니다. 입력은 신뢰할 수 없는 것으로 취급해야 하며, 워크플로를 편집하면 이를 사용하는 모든 훅에 영향을 줍니다.
마지막 지점은 조용한 유지보수 위험입니다. 하나의 워크플로가 여러 에이전트를 지원할 수 있으므로, 한 사용 사례를 위해 만든 변경이 다른 사용 사례로 전파됩니다. 공유 아티팩트에 존재하는 거버넌스에는 버전 관리 규율이 필요하며, 이는 대부분의 자동화 팀이 구축해야 했던 적이 없는 역량입니다.
이 설계는 또한 이름 붙일 가치가 있는 공백을 남깁니다. 조용히 실패하는 훅은 아무것도 통제하지 못하는 통제입니다. 입력을 검증하라는 Microsoft의 지침은 중요합니다. 에이전트는 실제 답변과 빈 답변을 구분할 수 없고, 나중에 로그를 읽는 감사자도 마찬가지이기 때문입니다.
SAP가 같은 날들에 한 일
SAP는 Joule 어시스턴트를 이른바 에이전트 작업 계층으로 확장했으며, 이는 Autonomous Enterprise 이니셔티브와 연결됩니다. 이 회사는 자사의 에이전트 허브가 현재 약 150개 회사에 걸쳐 10만 개 이상의 에이전트를 감독하고 있으며, 50개 이상의 도메인 어시스턴트가 200개 이상의 특화 에이전트를 오케스트레이션한다고 말합니다. 또한 Autonomous Close Assistant가 재무 결산을 몇 주에서 며칠로 압축할 수 있다고 주장합니다.
두 가지를 함께 놓으면 패턴은 분명합니다. 벤더들은 해석과 결정을 분리하고 있습니다. 모델은 인보이스를 읽고, 코드는 지급 여부를 결정합니다.
시점은 우연이 아닙니다. 두 벤더 모두 고객 배포에서 같은 실패 패턴을 목격했습니다. 데모에서는 작동했지만 프로덕션에서 아무도 지켜보지 않는 순간에 잘못된 판단을 내리는 에이전트입니다. 해결책은 의사결정을 모델 밖으로 옮기는 것입니다.
이 변화를 구매자에게 이해시키는 거버넌스 프레이밍이 있습니다. 규제 당국은 에이전트가 안전한지 묻는 것에서, 안전하지 않을 때 누가 비용을 부담하는지 묻는 것으로 이동했습니다. 결정론적 트리거, 필수 분기, 감사 추적을 제시할 수 있는 벤더는 답을 가집니다. 자율성을 판매하는 벤더는 그렇지 않습니다.
왜 밀도가 변화를 강제하는가
에이전트가 10만 개에 이르면 병목은 역량이 아니라 감독이 됩니다. 각 에이전트가 무엇을 했고, 왜 했으며, 누구의 권한 아래 했는지 아는 것은 에이전트를 작동시키는 것과는 다른 문제입니다.
SAP가 보고한 수치는 이 점을 구체화합니다. 50개 이상의 도메인 Joule 어시스턴트가 200개 이상의 특화 에이전트를 오케스트레이션하고, 약 150개 회사에 적용되며, Autonomous Close Assistant가 재무 결산을 몇 주에서 며칠로 압축합니다. 그런 밀도에서는 비공식적 감독이 무너집니다. 아무도 모든 트레이스를 읽지 않으며, 중요한 실패는 아무도 알아차리지 못하는 실패입니다.
비용도 같은 모양새입니다. 한 실무자의 Copilot Studio 가격 분석에 따르면 Copilot Credit당 약 $0.01로 추정되며, 액션 비용은 1~100 크레딧이고, 일반적인 그라운딩 워크플로는 약 30크레딧, 즉 약 $0.30입니다. 이는 규모가 커지기 전까지는 사소해 보입니다. 10만 회 실행은 약 $30,000이며, 에이전트는 사람이 클릭하기를 기다리지 않습니다. 월별 소비 한도를 하드하게 설정하는 것은 관리자 선호가 아니라 아키텍처 요구사항이 됩니다.
세 번째 압력도 있습니다. 설문조사에서 개발자들의 주간 AI 코딩 에이전트 사용률이 90%로 나타나면서, 이러한 워크플로 아래의 로직 상당 부분 자체가 기계가 작성한 것이 되었고, 이는 테스트 게이트, 코드 리뷰, 재생 가능한 로그의 가치를 높입니다. JetBrains 설문조사가 90% 수치의 출처이며, 이는 더 빠른 코드 생성이 자동으로 더 빠른 전달을 낳지는 않는다는 병행 발견과 일치합니다.
3계층 패턴
이어지는 아키텍처는 세 부분으로 구성됩니다. 의도 계층은 모델이 지저분한 요청을 해석하게 합니다. 결정론적 실행 계층은 작고 상태가 없으며 테스트 가능한 함수를 실행합니다. 컨트롤 플레인은 예산, 권한, 감사 추적을 강제합니다.
서버리스 엣지 워커는 요청당 비용이 저렴하고 격리되어 있으며 버전 관리가 쉬워 중간 계층에 적합합니다. 이 패턴은 새롭지 않습니다. 결제 시스템이 항상 신뢰할 수 없는 입력을 처리해 온 방식과 유사합니다. 달라진 점은 업계가 이제 사고 이후가 아니라 기본적으로 에이전트에 적용한다는 것입니다.
Microsoft가 제시한 사용 사례 목록은 이 패턴에 깔끔하게 들어맞습니다. 세션 시작 시 컨텍스트 추가, 도구 실행 전 검증, 결과 후처리, 실패 처리는 모두 수명 주기의 가로채기 지점입니다. Hooks는 이를 결정론적 코드가 에이전트가 하려는 일을 볼 수 있는 장소로 공식화합니다.
워크플로 설계에는 부차적 이점도 있습니다. 사후에 에이전트의 행동을 설명 가능하게 만듭니다. 입력과 출력을 기록하는 훅은 에이전트 자체가 결코 생성하지 않을 감사 기록을 만듭니다. 규제 당국에 대응해야 하는 팀에게 그 기록은 의도한 행동을 설명하는 것과 실제 행동을 입증하는 것의 차이입니다.
반복할 가치가 있는 경고 하나: 단일 벤더의 스튜디오 안에 작성된 거버넌스 로직은 임대한 거버넌스 로직입니다. 중요한 비즈니스 규칙은 옮길 수 있는 코드에 있어야 합니다. 이제 지속적인 가치는 컨트롤 계층에 있기 때문입니다.
경쟁 구도로 읽자면 두 벤더는 서로 다른 출발점에서 같은 결론에 도달했습니다. SAP는 승인 라우팅이 본래의 어휘인 비즈니스 프로세스 소프트웨어에서 왔습니다. Microsoft는 트리거와 조건이 이미 익숙한 로우코드 스튜디오에서 왔습니다. 이제 둘 다 자율성을 팔지 않습니다. 둘 다 거절할 수 있는 능력을 팔고 있습니다.
이 프레이밍은 구매자가 이러한 제품을 평가하는 방식도 바꿉니다. 이제 질문은 어느 에이전트가 가장 똑똑한가가 아닙니다. 무인으로 실행될 수 있을 만큼 정밀하게 제약할 수 있는 에이전트는 어느 것인지, 그리고 예상치 못한 일을 했을 때 기록을 남기는 에이전트는 어느 것인지입니다.
관련 글
위성 사진이 이제 로봇 훈련 데이터가 되다
피지컬 AI 학습의 병목은 더 이상 컴퓨팅이나 모델 성능이 아니었다. 그것은 합성 세계의 품질이 되었다.
구글 Gemini 3.5 라이브 번역, 멈춤을 없애다
화자 자신의 목소리로, 이미 주머니에 있는 휴대폰에서 연속 실행되는 번역은 기능을 열어야 하는 것에서 그냥 켜져 있는 것으로 옮긴다.
중국, AI 에이전트 최초의 강제 안전 표준을 제정하다
안전은 홍보하는 기능에서 통과해야 하는 관문으로 바뀐다. 위험 목록은 13개 범주, 97개 항목에 이른다.
AI 생성 콘텐츠, 이제 신분을 밝혀야 한다
이 한 걸음이 모든 문제를 해결하지는 않지만, 'AI 생성'을 숨길 수 있는 선택지에서 반드시 답해야 하는 질문으로 바꿔놓았다.