AI 게이트웨이는 왜 버퍼링을 꺼야 하는가 — 스트리밍 응답의 내부
ChatGPT처럼 한 글자씩 도착하는 응답의 뒤에는 Streamable HTTP가 있다. HTTP/1.1 chunked와 HTTP/2 DATA frame의 차이, LLM 토큰 스트리밍에서 버퍼링을 꺼야 하는 이유와 그 메모리 대가, 그리고 Envoy Gateway·APISIX 선택 기준까지.
ChatGPT처럼 한 글자씩 도착하는 응답의 뒤에는 Streamable HTTP가 있다. HTTP/1.1 chunked와 HTTP/2 DATA frame의 차이, LLM 토큰 스트리밍에서 버퍼링을 꺼야 하는 이유와 그 메모리 대가, 그리고 Envoy Gateway·APISIX 선택 기준까지.
Namespace의 Hugo Santos와 Madison Faulkner가 AI Engineer 채널에서 발표한 'CI/CD Is Dead' 영상을 정리하고, 핵심 질문에 대한 답을 찾는 과정. 에이전트 Harness가 만드는 코드 변화량의 폭발, 이를 수용하기 위한 Continuous Compute 아키텍처, 그리고 '준비한다'는 것이 구체적으로 무엇을 의미하는지까지.
Harness 플러그인으로 Nx 모노레포에 5개 AI 에이전트를 구성하고 병렬 감사를 실행한 실전기. 보안 취약점, 의존성 경고, 인터페이스 불일치 등을 한 세션에서 식별하고 조치한 과정과 토큰 비용 분석.
Astro + GitHub Pages 정적 블로그에 SEO 메타 태그, OG 이미지 자동 생성, Giscus 댓글, Cloudflare Workers 좋아요, GoatCounter 분석을 서버 비용 0원으로 구현한 과정을 정리합니다.
Next.js + NestJS 모노레포에서 GitHub Actions, ArgoCD, AKS로 구축한 CI/CD 파이프라인. PR별 격리 Preview 환경, 변경 감지 기반 선택적 빌드, GitOps 배포, 자동 cleanup을 다룹니다.
Kubernetes 1.35 Timbernetes 릴리스의 주요 신규 기능과 변경 사항을 정리합니다. In-Place Pod Resource Updates, Image Volumes, IPVS Deprecation 등 60개 개선 사항을 다룹니다.
Kubernetes 1.35에서 GA가 된 In-Place Pod Resize. Pod을 죽이지 않고 리소스를 동적으로 변경하는 원리, 실전 활용법, 주의사항을 정리합니다.
KEP-4639 기반 Image Volumes 기능으로 OCI 이미지를 Pod에 읽기 전용 볼륨으로 직접 마운트하는 방법과 동작 원리, 활용 사례를 정리합니다.
100개 이상의 LLM을 단일 OpenAI 형식으로 통합하는 LiteLLM. SDK와 Proxy Server의 차이, 실제 운영 경험, 도입 판단 기준을 공유합니다.
NanoClaw의 Telegram 기능을 skills engine 기반으로 전환하고, upstream과 fork custom의 3계층 코드 구조를 확립한 과정을 정리합니다.