

Claude Code의 Plan Mode - 코딩하기 전에 계획하라
Claude Code의 Plan Mode를 소개하며, 코딩 전에 계획과 분석을 먼저 수행하는 개발 방식을 설명했습니다. 스펙 파일, 메타 프롬프팅, 사고 레벨 활용으로 더 체계적인 구현을 돕는 방법을 정리했습니다.


Claude Code의 Plan Mode를 소개하며, 코딩 전에 계획과 분석을 먼저 수행하는 개발 방식을 설명했습니다. 스펙 파일, 메타 프롬프팅, 사고 레벨 활용으로 더 체계적인 구현을 돕는 방법을 정리했습니다.


Claude Code의 Plan Mode로 코드 작성 전에 분석과 계획을 먼저 세우는 방법을 소개했습니다. 스펙 파일, 메타 프롬프팅, 사고 레벨을 활용한 실전 프롬프트 전략도 다뤘습니다.


Co-STORM은 여러 AI 에이전트의 협력적 담화를 통해 사용자가 미지의 정보를 발견하도록 돕는 정보 탐색 시스템을 소개했습니다. 평가에서는 기존 검색 엔진과 RAG 기반 방식보다 깊이와 참신성에서 더 좋은 결과를 보였습니다.


사내 PPT 분석기 Chat PPT를 만든 LLMops 구현 과정과 운영 팁을 공유했습니다. 보안 제약 대응, VLM·LLM 연계, 품질 개선 반복이 핵심이었습니다.

해커톤에서 AI 채용 도우미 AIVA를 만들며 이력서와 과제 분석, 코드 실행 검증까지 실험했습니다. 프롬프트 설계와 캐싱, 토큰 제한을 고민하며 AI 시대 개발자의 자세도 함께 성찰했습니다.


In-house 데이터를 활용해 웹 검색의 한계를 보완하고, RAG 기반으로 검색 정확도와 응답 품질을 높이는 전략을 소개했습니다. 도메인별 검색 인프라와 질의 분석, 랭킹 최적화로 후속 액션까지 연결하는 구조를 설명했습니다.


AWS Summit Seoul 2025에서 생성형 AI 중심의 세션과 Expo를 체험한 소감과 인사이트를 정리했습니다. AWS 서비스가 실제 산업에 어떻게 적용되는지 다양한 사례로 살펴보았습니다.
쿠팡 파트너스
이 게시물은 쿠팡 파트너스 활동의 일환으로, 이에 따른 일정액의 수수료를 제공받습니다.


Langchain 없이 Python으로 ReAct 기반 LLM Agent를 직접 구현하는 예제를 소개했습니다. 프롬프트 설계와 멀티턴 흐름에 따라 함수 호출 결과가 달라질 수 있음을 보여줬습니다.


프롬프트 품질을 정량 평가하는 방법을 Prometheus 2와 OpenAI API 실습으로 설명했습니다. 각 평가 방식의 장단점과 환각 탐지 한계를 비교하며 자동화된 평가 파이프라인 필요성을 제시했습니다.


프롬프트 성능을 정량적으로 평가하는 방법을 Prometheus 2와 OpenAI API 실습으로 소개했습니다. 문맥 평가는 강점이지만 최신 사실 검증은 도구별 한계가 있어 반복 평가가 필요합니다.

AI가 답변을 넘어 실제 행동을 수행하는 시대에 접어들며 새로운 보안 위협이 부각되었습니다. 그래서 AI Red Teaming을 통해 프롬프트 인젝션과 명령 거부 같은 위험을 사전에 검증해야 한다고 설명했습니다.

AI가 단순 응답을 넘어 실제 행동을 수행하는 시대의 보안 위험을 설명했습니다. Red Teaming으로 명령 거부 실패와 프롬프트 인젝션을 사전에 점검하는 방법을 제안했습니다.