Anthropic의 Claude Code용 모드, 개발자가 에이전트 자체를 재작성할 수 있게 하다

Anthropic은 Claude Code용으로 '모드(mods)'라고 부르는 기능을 도입했습니다. 아이디어는 간결합니다. 코딩 에이전트의 동작 방식을 바꾸는 작은 TypeScript 함수로, 모델에 내장되는 대신 도구에 로드됩니다.
작은 릴리스지만 큰 함의를 지닙니다. 코딩 에이전트의 동작은 구성하는 대상에서 작성하는 대상으로 바뀝니다.
함수가 설정을 이기는 이유
오늘날 대부분의 에이전트 사용자 지정은 설정을 통해 이루어집니다. 온도, 도구 권한, 시스템 프롬프트, 허용된 명령 목록 등이죠. 이러한 노브(knob)에는 공통된 한계가 있습니다. 자연어로 선호를 설명하고 모델이 이를 존중하기를 바랄 뿐입니다. 모델이 다른 해석이 더 유용하다고 판단하면 설정은 무력해집니다.
모드는 코드입니다. 실행되고 반환되며 출력은 결정적입니다. 이는 제어의 성격을 바꿉니다. 에이전트가 특정 디렉터리를 절대 건드리지 않게 하려면, 적절한 위치의 모드가 정중히 요청하는 대신 이를 강제할 수 있습니다. 검토에 도달하기 전 모든 diff에 특정 변환을 적용하려면, 모드는 대부분의 경우가 아니라 매번 이를 수행할 수 있습니다.
트레이드오프는 일반적인 것입니다. 코드는 설정보다 더 강력하고 더 취약합니다. 버그가 있을 수 있습니다. 유지보수가 필요합니다. 장점은 강제가 여러분의 리포지토리, 버전 관리 아래, 관리 대상 코드 옆에 위치한다는 점입니다.
경쟁이 이동한 곳은 사용자 지정 계층
코딩 에이전트 시장을 보면 무게 중심이 이동했습니다. 기반 모델들은 수렴하고 있습니다. 오늘날 개발자가 이들 사이에서 선택할 때는 벤치마크 성능 몇 점을 두고 논쟁하는데, 이는 수년간 지속될 결정을 내리는 데 약한 근거입니다. 실제로 중요한 차이는 모델 주변 계층에 있습니다. 리포지토리를 어떻게 처리하는지, 규칙을 어떻게 존중하는지, 프로세스를 얼마나 흡수할 수 있는지입니다.
Anthropic만 그런 것은 아닙니다. 모든 진지한 코딩 에이전트가 훅, 규칙, 플러그인 표면을 추가해 왔습니다. 이유는 구조적입니다. 모델이 충분히 좋아져 원시적 능력이 결정적이지 않게 되면, 팀이 자신들의 판단을 도구에 인코딩할 수 있게 해주는 벤더가 강한 의견을 가진 팀을 얻습니다. 그리고 강한 의견을 가진 팀이야말로 얻을 가치가 있는 팀입니다.
모드가 신뢰에 대해 말하는 것
이 릴리스에는 더 조용한 해석도 있습니다. 개발자에게 에이전트 동작을 다시 작성할 방법을 주는 것은 벤더가 모든 워크플로를 예상할 수 없다는 인정입니다. 코딩 에이전트는 수천 개의 서로 다른 코드베이스 안에서 실행되며, 각각 고유한 역사, 고유한 관례, 위험한 변경에 대한 고유한 정의를 갖습니다. 어떤 기본 구성도 그 범위와 접촉을 견뎌내지 못합니다.
따라서 정직한 움직임은 이음새를 노출하는 것입니다. 자신의 코드베이스를 잘 아는 팀이 코드로 자체 규칙을 강제하고 결과에 책임을 지도록 하는 것입니다. 이는 설정 페이지에 체크박스를 하나 더 추가하고 모든 경우를 커버한다고 가정하는 것보다 더 성숙한 태도입니다.
또한 책임을 미묘하게 이동시킵니다. 나쁜 행동을 차단하는 모드는 고객의 모드입니다. 버그가 있어 해당 행동을 통과시키면 그 결과는 고객의 몫입니다. 이는 기능에 대한 불만이라기보다 모든 탈출구의 본질이며, 기업이 선호하는 운영 방식이기도 합니다. 그들은 경계를 벤더에 위임하고 발언권이 없는 것보다 경계를 통제하고 그에 대해 책임지는 쪽을 선호합니다.
빌드 대 구매의 경계가 다시 이동하다
수년간 개발자 도구에 관한 질문은 직접 만들 것인지 구매할 것인지였습니다. 코딩 에이전트는 그 경계를 밀어 움직였습니다. 모드는 이를 다시 한번, 특정 방향으로 밀어붙입니다. 모델은 구매한 상품으로 남습니다. 그 주변의 정책은 수십 줄의 TypeScript로 구축하는 것이 됩니다.
이는 건강한 분리입니다. 팀은 필요한 동작을 얻기 위해 자체 모델을 훈련해서는 안 되며, 변경할 수 없는 동작에 갇혀서도 안 됩니다. 가벼운 사용자 지정 표면이 이 두 극단 사이에 위치하며, 코딩 에이전트의 실질적 가치 상당 부분이 결국 여기서 결정될 것입니다.
확장성은 도구가 자신의 성공을 견뎌내는 방법
잠시 짚고 넘어갈 만한 개발자 도구의 패턴이 있는데, 모드는 여기에 정확히 들어맞습니다. 도구가 의견을 가지고 출시되어 추종자를 얻고, 그 추종자가 그 의견을 능가하게 되면 벽에 부딪힙니다. 처음 도입한 사용자들은 기본값에 만족했습니다. 나중에 도착한 사용자들은 기본값이 상상하지 못한 요구사항을 갖고 있으며, 그들은 자신이 원하는 대로 만들 수 있는 무언가를 찾아 떠납니다.
그 순간을 견뎌내는 도구는 이음새를 노출합니다. 커뮤니티가 도구 자체의 언어로 동작을 확장하도록 허용하고, 확장은 생태계 압력의 일부가 됩니다. 편집기는 플러그인을 작성하게 합니다. 빌드 시스템은 태스크를 작성하게 합니다. 모드를 작성하게 하는 코딩 에이전트는 같은 움직임을 취하고 있으며, 벽에 부딪히기 전에 그렇게 합니다. 이는 벤더가 이 영화를 전에 본 적이 있다는 신호입니다.
이음새는 또한 설정 페이지가 만들 수 없는 피드백 루프를 만듭니다. 팀이 모드를 게시하기 시작하면 벤더는 사람들이 계속 요청하는 동작을 확인하고 이를 기본값으로 제공하기 시작할 수 있습니다. 사용자 지정 표면은 연구 채널이 되고, 커뮤니티는 발견 작업을 무료로 수행합니다. 이것이 확장성의 조용한 배당금이며, 일반적으로 어떤 단일 모드보다 더 가치 있습니다.
앞으로 어디로 가는가
명백한 다음 단계는 공유입니다. 리포지토리에 있는 모드는 이미 이식 가능합니다. 공개 레지스트리, 일반적인 워크플로를 위한 커뮤니티 규칙 세트, 라이브러리를 가져오듯 잘 테스트된 모드를 가져오는 방법 등입니다. 이 모든 것은 출시된 것에서 짧은 거리에 있으며, 이 모든 것은 도구를 플러그인 폴더가 있는 앱에서 마켓플레이스가 있는 플랫폼으로 바꿉니다.
그 방향에는 이제 익숙한 위험이 있습니다. 공유 모드는 자격 증명과 소스를 보유한 도구 내부에서 실행되는 신뢰할 수 없는 코드입니다. 에이전트 보안 분야는 신뢰할 만해 보이는 작은 자동화 조각이 어떻게 공격 경로가 되는지 정확히 문서화하는 데 한 해를 보냈습니다. 모드용 레지스트리는 발견보다 신뢰를 먼저 해결해야 하며, 이를 일급 문제로 취급하는 벤더가 개발자들이 의지하는 벤더가 될 것입니다.
릴리스 자체는 변경 로그의 몇 문단에 불과합니다. 그것이 가리키는 방향은 더 큽니다. 코딩 에이전트는 플랫폼이 되고 있으며, 자체 규칙을 코드로 인코딩하고 그 규칙을 버전 관리 아래 유지함으로써 그렇게 대하는 팀은 올바른 체크박스를 찾아 설정을 헤매는 팀보다 앞으로 몇 년 동안 더 많은 것을 얻을 것입니다.
다만 언급할 만한 한계가 있습니다. 모든 팀에 모드를 작성하고 유지하고 싶어 하는 사람이 있는 것은 아니며, 소수 개발자만 건드리는 사용자 지정 표면은 나머지 모두에게 큰 변화를 주지 않습니다. 모드의 가치는 건강한 공유 모드 세트, 잘 유지 관리되는 모드가 나오는지에 달려 있습니다. 플러그인 생태계가 소스를 한 번도 열지 않는 사람들에게 편집기를 더 유용하게 만드는 방식처럼 말입니다. 그때까지 모드는 강한 의견을 가진 팀을 위한 강력한 기능입니다. 그리고 밝혀진 바에 따르면, 그것은 이미 프로덕션에서 코딩 에이전트를 실행하는 대부분의 팀을 설명합니다.
관련 글
Agility Digit 5, 단순한 스펙 시트가 아닌 안전성 입증 자료와 함께 출시되다
창고 현장은 실험실이 아니다. 관문은 인증이지 데모가 아니다.
프론티어 에이전트가 연구 워크플로의 30퍼센트를 완료했다. 그 숫자가 핵심이다.
에이전트는 연구를 운영할 수 있다. 절차를 새로 고안하는 일은 아직 요원하다.
Figure AI, 판매할 제품도 없이 35억 달러어치 컴퓨팅을 확보하다
베팅의 핵심은 일반화가 컴퓨팅 문제라는 것이다. 업계는 아직 결론을 내리지 못했다.
OpenAI, 마침내 이미지 API에 투명 배경 추가
파이프라인에서 한 단계를 통째로 없애는 작은 기능.