
금융 보안 퀴즈, AI에게 풀게 해봤습니다: 2025 금융 AI Challenge 우수상 후기
금융보안 AI 경진대회에서 24GB 단일 GPU 제약 아래 LLM 파이프라인을 설계하고 우수상을 수상한 과정을 정리했습니다.\n모델 선정부터 CPT, RAG, 양자화, 출력 제어까지의 선택 이유와 성능 개선 결과를 공유했습니다.

금융보안 AI 경진대회에서 24GB 단일 GPU 제약 아래 LLM 파이프라인을 설계하고 우수상을 수상한 과정을 정리했습니다.\n모델 선정부터 CPT, RAG, 양자화, 출력 제어까지의 선택 이유와 성능 개선 결과를 공유했습니다.

Software 3.0 시대의 Claude Code를 기존 layered architecture 관점으로 풀어낸 글입니다. 또한 HITL, 토큰 관리, 스킬 설계의 실무 포인트를 정리했습니다.
GPT-4o-mini 번역의 오역과 운영 리스크를 줄이기 위해 TranslateGemma를 온프레미스 대안으로 실험했습니다. 한국어 리뷰 번역 비교에서 용어 보존과 자연스러움이 더 나은 결과를 확인했습니다.

에이전틱 코딩의 환각과 일관성 문제를 줄이기 위해 SDD와 Spec-kit 도입 사례를 공유했습니다. 스펙 정의와 검증 중심의 개발 흐름이 팀 협업에 유리하다고 정리했습니다.


네오사피엔스가 AWS g5, g6e, g7e에서 LLM 추론 배치와 정밀도를 비교했습니다. 실제 운영 조건을 반영해 g6e + INT8 조합을 최적점으로 선택했습니다.

AI 에이전트가 SaaS의 UI 중심 구조와 사업 모델을 바꾸고 있다는 관점을 제시했습니다. QueryPie의 AI 네이티브 전환 사례를 통해 조직과 제품의 대응 전략을 설명했습니다.
AI 코딩이 보조 도구에서 에이전트 중심 개발로 바뀐 1년의 흐름을 정리했습니다. 스펙, 문서, 테스트를 레포 안에 쌓아 에이전트가 일할 환경을 설계한 과정입니다.
쿠팡 파트너스
이 게시물은 쿠팡 파트너스 활동의 일환으로, 이에 따른 일정액의 수수료를 제공받습니다.

Kanana-V의 기능 확장 내용을 소개하는 글입니다. 한국 문화 이해와 문서, 다중 이미지, GUI 조작까지 다룹니다.

AWS re:Invent 2025에서 Agentic AI와 관리형 클라우드 기술의 방향을 살펴보았습니다. 프로덕션 운영과 보안 관점에서 카카오뱅크에 적용할 인사이트를 정리했습니다.

RAG의 필요성과 동작 원리를 설명하고, 교육 운영 시스템에 적용한 구현 사례를 정리했습니다. 6단계 구현 가이드와 색인·검색 설계 포인트도 함께 소개했습니다.

NeurIPS 2025에서 다뤄진 AI 가드레일 연구 흐름을 정책 코드화, 멀티모달 안전성, 프롬프트 인젝션 방어 관점에서 정리했습니다. 실서비스에서 안전성과 사용성을 함께 만족시키는 방향으로 가드레일이 진화하고 있음을 설명했습니다.

엔터프라이즈 LLM 서비스에서 파인 튜닝, 청킹, 복잡한 워크플로를 덜어내고 단순한 구조를 선택한 사례를 다뤘습니다. 문서 참조, 검색 후 자르기, ReAct 조합으로 응답률을 높인 운영 경험을 공유했습니다.