글
여기까지 쓴 글을 모아뒀습니다.
· 백엔드
stdout만으로는 실행 상태도 권한도 취소도 구분되지 않는다
Coding Agent CLI를 stdout으로 감싸면 실행 상태와 도구 호출, 권한 요청, 취소가 한 덩어리로 섞인다. ACP가 그 경계를 어떤 사건으로 갈라놓는지 읽고, Slack 멀티 에이전트 시스템에 붙이기 전에 무엇부터 캡처할지 정리한다.
· 백엔드
NestJS 에이전트의 모델 운영 경계를 LiteLLM으로 분리할 수 있을까
credential, budget, rate limit, fallback, 비용 추적을 LiteLLM으로 넘기는 경계를 그려보고, CLI 구독으로 모델을 부르는 지금 구조에는 왜 그대로 붙지 않는지까지 짚는다.
· 백엔드
에이전트 평가는 답이 아니라 경로를 봐야 한다
trajectory-based evaluation으로 에이전트의 도구 호출, 근거 조회, fallback을 회귀 테스트하는 방법을 정리한다.
· 백엔드
Deep Agents는 프레임워크보다 실행 하네스다
Deep Agents의 planning, filesystem, subagents, human-in-the-loop를 장기 에이전트 작업의 실행 구조라는 관점에서 살펴본다.
· 백엔드
일찍 멈추는 에이전트를 다시 움직이게 하는 루프·하네스·그래프
코딩 에이전트는 이미 루프로 움직이지만 컨텍스트가 차오르면 스스로 일찍 멈춰요. 여기에 하네스와 그래프를 붙이면 반복만이 아니라 도구·권한·상태와 작업 흐름까지 설계할 수 있어요.
· 백엔드
감사 로그에 bot과 backend만 남는데 write action을 열어도 될까
봇 토큰만 쓰면 감사 로그에 bot과 backend만 남는다. user → agent → tool 호출 체인에 위임 범위와 감사 맥락을 남기는 설계안을 표준 draft와 제품 문서를 근거로 정리한다.
· 백엔드
봇이 커지자 무엇이 agent이고 무엇이 workflow인지 흐려졌어요
Slack 업무봇에 기능을 더할 때마다 실행 기록과 평가 지점을 다시 정하게 돼요. Mastra가 경계를 긋는 방식을 기준 삼아 무엇을 모델 판단에 남기고 무엇을 정해진 순서로 굳힐지 다시 나눠 봤어요.
· 백엔드
도구가 많을수록 Code Mode가 맞는 이유
Cloudflare Agents SDK의 Code Mode가 복잡한 도구 실행 계획과 중간 데이터를 어떻게 다루며, 어떤 작업에 적용할 만한지 살펴본다.