← 피드로
최신 모델은 가중치에 저장하는 세계 지식을 줄이는 대신 수학·코드 추론 성능을 높여, 더 적은 활성 매개변수로 높은 벤치마크 점수를 내도록 설계되고 있음 사실 기억에서는 반대 결과가 나타나 SimpleQA 정확도는 최고 모델도 53%에 그치며, Qwen3.5 4B·9B의 지…
출처: news.hada.io · https://news.hada.io/topic?id=32564