필터 1
엔터프라이즈 LLM 서비스 구축기 1: 컨텍스트 엔지니어링
라인
AI

엔터프라이즈 LLM 서비스 구축기 1: 컨텍스트 엔지니어링

대규모 LLM 서비스에서 프롬프트보다 컨텍스트 설계가 더 중요하다는 점을 설명했습니다.\n필요한 도구와 정보만 단계적으로 주입해 성능 저하와 환각을 줄인 방법을 공유했습니다.

#LLM#RAG
113005분
스탠퍼드 대학교는 왜 ‘코딩 말고 다른 것’을 가르치기 시작했을까?
농심NDS
AI

스탠퍼드 대학교는 왜 ‘코딩 말고 다른 것’을 가르치기 시작했을까?

생성형 AI 시대에는 코딩보다 문제 정의와 검증의 중요성이 커졌습니다. AI를 잘 쓰는 조직일수록 판단과 책임의 역할을 더 분명히 해야 했습니다.

#LLM#prompt
147005분
Claude Code 컨텍스트 최적화 가이드
인포그랩
AI

Claude Code 컨텍스트 최적화 가이드

Claude Code에서 컨텍스트가 길어질수록 응답 품질이 떨어지는 문제를 설명했습니다. CLAUDE.md, 프롬프트 간결화, 작업 분할, 내장 명령어로 컨텍스트를 관리하는 방법을 정리했습니다.

#Claude Code#LLM
193005분
Strands Agent SOPs 소개 – AI 에이전트를 위한 자연어 워크플로우
AWS
AI

Strands Agent SOPs 소개 – AI 에이전트를 위한 자연어 워크플로우

AI 에이전트 워크플로우를 자연어 SOP로 표준화하는 Strands Agent SOPs를 소개했습니다.\n제어와 유연성의 균형, 체이닝, MCP·Claude Skills 연동 예시를 설명했습니다.

#LLM#prompt
55005분
AI 스케일링과 동질화의 경계: NeurIPS 2025 핵심 트렌드 분석
데보션
AI

AI 스케일링과 동질화의 경계: NeurIPS 2025 핵심 트렌드 분석

NeurIPS 2025에서 스케일링 이후의 AI 흐름과 동질화, 평가 한계를 살펴보았습니다. XAI와 Causality를 통해 설명과 인과를 구분해 보는 시사점도 정리했습니다.

#LLM#ML
50005분
NVIDIA Cosmos: WFM의 세 가지 핵심 모델과 피지컬 AI의 활용
데보션
AI

NVIDIA Cosmos: WFM의 세 가지 핵심 모델과 피지컬 AI의 활용

NVIDIA Cosmos는 피지컬 AI를 위한 World Foundation Model로, 예측·전이·추론의 세 가지 모델을 제공합니다. 합성 데이터 생성과 검증을 통해 자율주행과 로봇 학습의 안전성과 효율성을 높였습니다.

#NVIDIA#LLM
30005분
CrewAI: 독립된 멀티 에이전트 협업 프로세스 구축
데보션
AI

CrewAI: 독립된 멀티 에이전트 협업 프로세스 구축

CrewAI의 핵심 구성 요소와 독립형 Python 프레임워크 특성을 소개했습니다. 단일 에이전트와 멀티 에이전트 순차 협업 예시로 기본 사용 흐름을 설명했습니다.

#Python#LLM
44005분
Antigravity 사용 후기: sync & async 코딩을 곁들인
데보션
AI

Antigravity 사용 후기: sync & async 코딩을 곁들인

Antigravity 사용 후기를 통해 무료 가격, 다양한 모델, Sync 코딩의 장점을 정리했습니다. 다만 영어 추론 토큰, 애매한 자율성, 멀티에이전트 안정성은 아쉬움으로 남겼습니다.

#Gemini#Claude
95005분
LLM과 Reveal.js로 슬라이드를 쉽게 만들고 공유하기
데보션
AI

LLM과 Reveal.js로 슬라이드를 쉽게 만들고 공유하기

블로그 글을 LLM으로 요약해 Reveal.js 슬라이드로 바꾸는 방법을 소개했습니다. GitHub Pages 배포까지 연결해 빠른 제작과 공유 효율을 높였습니다.

#LLM#Reveal.js
37005분
[오프라인/마감] AI 이후, 실리콘밸리 개발자는 어떻게 일하고 있는가
구름
기타

[오프라인/마감] AI 이후, 실리콘밸리 개발자는 어떻게 일하고 있는가

AI 이후 실리콘밸리 개발자의 역할과 일하는 방식 변화를 다루는 오프라인 세미나를 소개했습니다. 현장 사례를 통해 앞으로 무엇을 준비해야 할지 힌트를 얻을 수 있습니다.

#LLM#세미나
27005분
마이리얼트립
AI

서버 코드 자동 생성 툴 — Sherpa는 왜 완전 자동화를 선택하지 않았을까

Sherpa는 완전 자동화보다 검증 가능한 구조를 우선해 설계했습니다. HTML을 기준 진리로 삼고 단계별 파이프라인과 검증 뷰어로 신뢰성을 높였습니다.

#REST API#HTML
85005분
하이퍼엑셀(HyperAccel), Amazon EC2 F2 Instance 기반 LPU로 고효율 LLM 추론 서비스 구축
AWS
AI

하이퍼엑셀(HyperAccel), Amazon EC2 F2 Instance 기반 LPU로 고효율 LLM 추론 서비스 구축

하이퍼엑셀은 EC2 F2 인스턴스와 FPGA를 활용해 LPU 기반 LLM 추론 환경을 클라우드로 구축했습니다. PoC 운영 시간을 크게 줄이고 비용과 보안 부담도 낮췄습니다.

#LLM#추론
32005분