기술과 일상을 함께 기록합니다.
sLLM을 API로 서빙할 때 필요한 모델 구성, 로컬 호출 예시, 지연 시간과 장애 점검 방법을 설명한다.
작은 언어 모델의 과제를 정의하고 데이터를 분리한 뒤 LoRA로 미세 조정하고 평가하는 흐름을 설명한다.