#kubernetes
2개 글
CI 최적화, 626초에서 90초까지: 실패한 가설과 측정법
2026-08-20셀프호스티드 CI를 최적화하며 runner, shard, worker, K를 어떻게 측정하고 조정했는지 실패 사례와 함께 정리한다
LLM 에이전트 플랫폼 아키텍처 - 챗 스트리밍과 long-running 작업의 durability를 어떻게 reconcile할 것인가
2026-04-29챗은 빨라야 하고 long-running 작업은 끊겨도 이어져야 한다. 두 요구를 한 시스템에서 어떻게 reconcile하는가 - 흔한 dual-path 구현의 한계부터 LangGraph Platform / OpenAI Responses / Vercel AI SDK / Cloudflare Agents의 패턴, 그리고 정반대로 가는 OpenAI Realtime까지.