목록 보기
경량화 레시피: Teacher 지식 조린 소형 모델, 근데 성능을 곁들인
AI

경량화 레시피: Teacher 지식 조린 소형 모델, 근데 성능을 곁들인

네이버 D2
네이버 D2
2024년 11월 4일

두줄요약

서비스용 LLM을 성능 저하 없이 소형화하는 경량화 레시피를 소개했습니다. 제목 추천과 키워드 추출 사례로 실무 적용 방식을 다뤘습니다.

핵심 내용

  • 서비스 애플리케이션 요구사항을 충족하는 LLM을 성능 열화 없이 Small LLM으로 경량화하는 레시피 소개
  • Teacher 지식을 활용해 소형 모델의 품질을 유지하는 방향의 발표 세션 공개
  • 제목 추천, 사물 키워드 추출 같은 적용 사례를 통해 경량화 접근을 설명

다음 읽기

#LLM 주제를 이어서 읽기

레거시 GPU에 날개 달기: 극한의 서빙 최적화 가이드

BERT 기반 SPLADE 모델의 대규모 실시간 서빙 최적화 방법을 소개했습니다. FlashTokenizer와 전/후처리, 추론 최적화로 레거시 GPU 성능을 끌어올린 사례입니다.

네이버 D2
네이버 D2
AI

댓글 0

댓글을 작성하려면 로그인이 필요합니다.

댓글을 불러오는 중...