백엔드
이 분류로 묶인 글 "백엔드".
· 백엔드
NestJS 에이전트의 모델 운영 경계를 LiteLLM으로 분리할 수 있을까
credential, budget, rate limit, fallback, 비용 추적을 LiteLLM으로 넘기는 경계를 그려보고, CLI 구독으로 모델을 부르는 지금 구조에는 왜 그대로 붙지 않는지까지 짚는다.
· 백엔드
에이전트 평가는 답이 아니라 경로를 봐야 한다
trajectory-based evaluation으로 에이전트의 도구 호출, 근거 조회, fallback을 회귀 테스트하는 방법을 정리한다.
· 백엔드
Deep Agents는 프레임워크보다 실행 하네스다
Deep Agents의 planning, filesystem, subagents, human-in-the-loop를 장기 에이전트 작업의 실행 구조라는 관점에서 살펴본다.
· 백엔드
일찍 멈추는 에이전트를 다시 움직이게 하는 루프·하네스·그래프
코딩 에이전트는 이미 루프로 움직이지만 컨텍스트가 차오르면 스스로 일찍 멈춰요. 여기에 하네스와 그래프를 붙이면 반복만이 아니라 도구·권한·상태와 작업 흐름까지 설계할 수 있어요.
· 백엔드
감사 로그에 bot과 backend만 남는데 write action을 열어도 될까
봇 토큰만 쓰면 감사 로그에 bot과 backend만 남는다. user → agent → tool 호출 체인에 위임 범위와 감사 맥락을 남기는 설계안을 표준 draft와 제품 문서를 근거로 정리한다.
· 백엔드
봇이 커지자 무엇이 agent이고 무엇이 workflow인지 흐려졌어요
Slack 업무봇에 기능을 더할 때마다 실행 기록과 평가 지점을 다시 정하게 돼요. Mastra가 경계를 긋는 방식을 기준 삼아 무엇을 모델 판단에 남기고 무엇을 정해진 순서로 굳힐지 다시 나눠 봤어요.
· 백엔드
도구가 많을수록 Code Mode가 맞는 이유
Cloudflare Agents SDK의 Code Mode가 복잡한 도구 실행 계획과 중간 데이터를 어떻게 다루며, 어떤 작업에 적용할 만한지 살펴본다.
· 백엔드
에이전트가 속는 건 막을 수 없다면, 권한 경계는 어디서 끊어야 할까
prompt injection을 완전히 막는 방법은 없다는 전제에서, 잘못된 판단이 권한 오남용으로 이어지지 않게 실행 경계를 어디서 끊을지 정리했다.