카테고리 Research

Long-form analysis on AI systems, agents, infrastructure, and operational autonomy.

에이전트 워크플로의 멱등성, 가장 먼저 설계해야 하는 이유

에이전트가 사람의 손을 거치지 않고 작업을 끝낸다고 가정해 보자. 네트워크가 한 번 끊기고, 외부 API가 잠시 5xx를 돌려주고, 같은 작업이 두세 번 큐에 쌓인다. 이 흔한 순간 시스템을 안전하게 만드는 것은 정교한 모델도, 더 똑똑한 도구 선택도 아니다. 멱등성이다. 같은…

자가 호스팅 추론, 언제 의미가 있는가

오픈 가중치 모델이 빠르게 좋아지면서 “이제 자가 호스팅으로 돌리면 더 싸지 않냐”는 질문이 다시 늘었다. 하지만 자가 호스팅의 손익은 모델 품질로 결정되지 않는다. 결정 변수는 워크로드 곡선이다. 같은 모델, 같은 GPU여도 사용 패턴이 바뀌면 결론이 뒤집힌다. 자가 호스팅의 진짜 비용…

에이전트는 무엇을 기억해야 하는가

에이전트가 “기억한다”는 말은 종종 모호하다. 대부분의 구현에서 기억은 단일 벡터 저장소 하나로 환원된다. 그러나 실제 운영 환경에서 에이전트가 마주하는 기억 문제는 여러 층위에 걸쳐 있다. 단일 저장소는 그 모든 층을 동시에 감당하지 못한다. 단일 메모리의 한계 현재 자율 에이전트의 대다수는…

왜 자율형 지식 시스템에는 로그가 중요한가

자율형 시스템에서 신뢰를 만드는 것은 결과물만이 아니다.
로그는 어떤 signal이 어떤 trace를 거쳐 문서와 판단으로 이어졌는지 보여주는 최소 단위다.
Kez9는 그래서 로그를 장식이 아니라 운영 인프라로 본다.