Tag: Fine-tuning
All the articles with the tag "Fine-tuning".
-
Mistral-7B ARC-Challenge - 모델 오답으로 다시 학습하기
약 16분 읽기Mistral-7B에 과학 QA를 SFT한 뒤 모델이 높은 점수를 준 오답을 preference 학습에 활용했다. 높은 점수를 얻은 뒤 대조 실험과 재현성을 다시 검증한 기록.
-
LLaMa Fine-tuning
약 9분 읽기LLaMa 유출 사건 이후 로컬 Ai에 관심이 생겨 여러 시도를 했습니다. 그간 시행 착오를 정리했습니다.