필터 1
네이버 D2
데브옵스

MLXP : Kubernetes LLM Serving 최적화 기술 도입기

Kubernetes 환경에 LLM 서빙 최적화 기술을 도입하며 발생한 충돌과 해결 과정을 공유했습니다. Istio, 스케줄러, Pod 보호 정책과의 실전 문제를 진단한 사례입니다.

#Kubernetes#LLM
63005분
[AWS Summit Korea 2026] 규제 환경에서의 통제 가능한 AI 에이전트 아키텍처
농심NDS
AI

[AWS Summit Korea 2026] 규제 환경에서의 통제 가능한 AI 에이전트 아키텍처

규제 환경에서 AI 에이전트를 안전하게 운영하기 위한 거버넌스와 통제 아키텍처를 정리했습니다. 모델 출력과 에이전트 행동을 분리해 제어하고, 운영 중에도 지속 검증하는 방법을 소개했습니다.

#LLM#AWS
25005분
Amazon EKS에서 NVIDIA OSMO 기반 Physical AI 워크플로 운영하기
AWS
데브옵스

Amazon EKS에서 NVIDIA OSMO 기반 Physical AI 워크플로 운영하기

Amazon EKS에서 NVIDIA OSMO를 활용한 Physical AI 워크플로 운영 레퍼런스 아키텍처를 소개했습니다. GPU 스케줄링, 아티팩트 보존, 모니터링, 보안을 함께 다루는 방법을 설명했습니다.

#Amazon EKS#NVIDIA OSMO
31005분
[기술분석] Kubernetes Gateway API에서 트래픽을 세밀하게 제어하는 Policy 객체 파헤치기
KT 클라우드
데브옵스

[기술분석] Kubernetes Gateway API에서 트래픽을 세밀하게 제어하는 Policy 객체 파헤치기

Kubernetes Gateway API의 Policy 객체로 트래픽 제어를 세밀하게 나누는 방법을 정리했습니다. Ingress Annotation 대신 표준 CRD와 attach 방식 차이를 이해하는 것이 핵심입니다.

#Kubernetes#Gateway API
5005분
[전환가이드] ArgoCD·FluxCD GitOps 배포를 HelmRelease로 전환하는 방법
KT 클라우드
데브옵스

[전환가이드] ArgoCD·FluxCD GitOps 배포를 HelmRelease로 전환하는 방법

ArgoCD 배포를 정적 YAML 대신 HelmRelease와 FluxCD로 전환하는 방법을 정리했습니다. values 분리, 순서 보장, 에어갭 배포까지 운영 포인트를 함께 다뤘습니다.

#ArgoCD#FluxCD
15005분
[운영가이드] Kubernetes 기반 Fault-Tolerant GPU 클러스터 유지 관리
KT 클라우드
데브옵스

[운영가이드] Kubernetes 기반 Fault-Tolerant GPU 클러스터 유지 관리

Kubernetes 기반 GPU 클러스터를 안정적으로 운영하기 위한 유지 관리 방안을 정리했습니다. 자동화, 관측, 스케줄링 통합, 네트워크·보안 분리를 통해 장애 대응과 성능 안정성을 높이는 방법을 소개했습니다.

#Kubernetes#GPU
9005분
[도입전략] Git 시크릿 관리와 Vault 도입으로 보안 강화하기
KT 클라우드
데브옵스

[도입전략] Git 시크릿 관리와 Vault 도입으로 보안 강화하기

Git 평문 시크릿과 K8s Secret 오브젝트를 함께 없애기 위한 Vault 도입 전략을 정리했습니다. 운영 설계와 예외 처리, 감사 로그와 토큰 회수까지 함께 챙겨야 합니다.

#Vault#Kubernetes
33005분
[AI인프라] GPU 5만장 시대, AI 인프라 비즈니스 성공 조건
KT 클라우드
AI

[AI인프라] GPU 5만장 시대, AI 인프라 비즈니스 성공 조건

GPU 수량 경쟁보다 풀스택 최적화가 AI 인프라 비즈니스의 핵심이라고 설명했습니다. 운영 효율과 총비용 관점에서 AI NIC와 베어메탈 아키텍처의 중요성을 짚었습니다.

#AI인프라#GPU
39005분
[기술이 장르가 되는 곳, kt cloud] 케클러 인터뷰 시리즈 #2 장애에도 서비스가 멈추지 않는 ‘Multi-AZ’ 엔지니어링 비하인드
KT 클라우드
아키텍처

[기술이 장르가 되는 곳, kt cloud] 케클러 인터뷰 시리즈 #2 장애에도 서비스가 멈추지 않는 ‘Multi-AZ’ 엔지니어링 비하인드

장애 복구보다 서비스 연속성을 우선한 kt cloud의 Multi-AZ 설계를 소개했습니다. 2개 AZ와 Satellite Zone으로 Active-Active와 쿼럼 유지를 함께 구현했습니다.

#Kubernetes#OpenStack
51005분
무신사
AI

VLM을 쓰지 않은 이유: Geometric Prior로 25배 빠른 의류 디테일컷 자동화

중고 의류 디테일컷 자동 생성을 위해 VLM 대신 Detector와 규칙 기반 크롭을 선택했습니다.\n그 결과 공정 시간을 90% 줄이고 11만 개 상품에 일괄 적용했습니다.

#LLM#AWS Lambda
93005분
[기술 분석] kubernetes Ingress API의 중단. 그 뒤를 잇는 Gateway API 파헤치기
KT 클라우드
데브옵스

[기술 분석] kubernetes Ingress API의 중단. 그 뒤를 잇는 Gateway API 파헤치기

Kubernetes Ingress NGINX 중단 배경과 Gateway API의 필요성을 설명했습니다. Nginx Gateway Fabric 설치와 Gateway, HTTPRoute 기반 트래픽 흐름도 함께 다뤘습니다.

#Kubernetes#Gateway API
62005분
현대오토에버의 Amazon Bedrock으로 구축한 다중 AI 에이전트: 장애 대응 시간 5분으로 단축하기
AWS
AI

현대오토에버의 Amazon Bedrock으로 구축한 다중 AI 에이전트: 장애 대응 시간 5분으로 단축하기

현대오토에버가 Amazon Bedrock과 LangGraph로 다중 AI 에이전트를 구성해 장애 대응을 자동화했습니다.\n장애 분석부터 보고서 생성까지를 연결해 대응 시간을 수 시간에서 5분으로 줄였습니다.

#Amazon Bedrock#LangGraph
48005분