← 피드로
Kanana-2 SLM 모델군으로 3B 모델과 이를 압축한 1.3B 모델의 Base/Instruct 가중치를 제공 Kanana-2-3B는 TPU 클러스터에서 처음부터 사전학습한 뒤 인스트럭션 파인튜닝과 강화학습을 적용했으며, 1.3B 모델은 단계적 가지치기와 증류…
출처: news.hada.io · https://news.hada.io/topic?id=32124
답글 남기기