[클로바 시선 #56] 충돌은 나누고, 성능은 합치다: 효율적인 LLM Post-training 전략 MERIT
멀티모달 LLM 후학습에서 서로 다른 데이터를 섞을 때 생기는 충돌 문제를 다뤘습니다. 효율적인 Post-training 전략 MERIT를 소개했습니다.
멀티모달 LLM 후학습에서 서로 다른 데이터를 섞을 때 생기는 충돌 문제를 다뤘습니다. 효율적인 Post-training 전략 MERIT를 소개했습니다.

AITRICS 연구팀이 ICLR 2023 TML4H 워크숍에서 환자 악화 예측 모델로 최고 논문상을 수상했습니다. 멀티모달 EHR와 자기지도 학습으로 1시간 단위의 정밀 예측 성능을 높였습니다.

대규모 서비스의 이미지 콘텐츠 모더레이션을 위해 멀티모달 LLM과 전통적 ML을 결합한 구조를 소개했습니다. 정확도, 지연 시간, 비용, 정책 유연성을 함께 개선하는 최적화 과정을 다뤘습니다.


TwelveLabs Marengo 3.0의 멀티모달 비디오 검색 전략을 정리했습니다. 고정 가중치, 순위 기반 융합, 의도 기반 라우팅의 차이와 트레이드오프를 설명했습니다.


Amazon Bedrock의 TwelveLabs Marengo로 비디오를 멀티모달 임베딩으로 변환해 시맨틱 검색을 구현한 사례입니다. OpenSearch Serverless와 결합해 텍스트·이미지·오디오 질의로 관련 클립을 찾는 흐름을 소개했습니다.

X

한국어 텍스트와 이미지를 함께 처리하는 멀티모달 임베딩 모델 개발기를 소개했습니다. 자연어 기반 사진 검색과 유사 상품 추천 사례를 중심으로 설명했습니다.
쿠팡 파트너스
이 게시물은 쿠팡 파트너스 활동의 일환으로, 이에 따른 일정액의 수수료를 제공받습니다.

X


Amazon Bedrock으로 소셜 미디어 콘텐츠를 분석하는 멀티 에이전트 시스템 구축 사례를 소개했습니다. 스트리밍 처리와 브랜드 정규화, 모니터링 체계를 통해 확장성과 운영성을 높였습니다.


미리디는 멀티모달 AI 디자인 품질을 높이기 위해 프롬프트 엔지니어의 역할을 중요하게 보고 있습니다. 프롬프트 설계뿐 아니라 실험, 평가 지표, 협업 역량까지 요구하고 있습니다.

오디오, 이미지, 환경 정보를 결합한 멀티모달 AI로 블랙아이스를 감지하는 솔루션을 소개했습니다. 공공기관 평가에서 정검지율 96.7%를 기록하며 야간·악천후 상황의 한계를 보완했습니다.


GS리테일은 Amazon Bedrock으로 와인 라벨 이미지 검색 서비스를 구축했습니다. Claude와 멀티모달 임베딩, Elasticsearch를 결합해 다국어 라벨 검색 품질을 높였습니다.