데보션2025년 10월 29일AIAI Agent 속도 최적화를 위한 Speculative DecodingSpeculative Decoding으로 AI Agent의 응답 지연을 줄이는 원리를 설명했습니다. Small Model 예측과 Large Model 검증을 결합해 속도 개선 가능성을 제시했습니다.#LLM#Speculative Decoding39005분