← 피드로
Fireworks Research가 Kimi K3 기반 특화 모델 Ember-1을 공개함. 불필요한 추론을 줄이도록 학습해 K3 수준의 품질을 유지하면서 토큰 사용량을 40% 절감하는 모델임 단순히 추론 강도를 낮추면 품질 손실이 커지는 문제를 별도 학습으로 해결함…
출처: news.hada.io · https://news.hada.io/topic?id=34379