
AI
안드로이드에서 Gemma2 파인튜닝 모델 실행하기
두줄요약
안드로이드에서 Gemma2 파인튜닝 모델을 실행하는 과정을 파인튜닝, MediaPipe 변환, 온디바이스 실행 순서로 설명했습니다. 한국어 요약 모델 예시와 파인튜닝 전후 비교, 긴 입력 시 제약도 함께 다뤘습니다.
핵심 내용
- 안드로이드에서 Gemma2 파인튜닝 모델을 실행하는 전체 흐름 정리
- Gemma2
.safetensors파인튜닝, MediaPipe용.bin변환, Android on-device 실행 단계로 구성 - 네이버 기사 요약 데이터셋으로 한국어 요약 모델을 학습하고, 파인튜닝 전후 결과를 비교
GEMMA2_2B설정과LlmInferenceOptions를 활용한 MediaPipe Android 데모 연동
적용해볼 점
- 파인튜닝된 LLM을 모바일 기기에서 직접 실행하는 실험 경로 참고
- MediaPipe 변환 스크립트와 Android 데모를 조합한 온디바이스 추론 적용 가능성 검토
- 긴 입력에서의 로딩 문제 같은 제약도 함께 확인 필요
