← 피드로
AMD가 모델 가중치를 실리콘에 직접 새기는 Taalas를 인수해 Nvidia가 주도하는 고성능 추론 시장 공략을 강화함 TSMC 6nm 공정의 모델 전용 칩 HC1은 Meta Llama 3.1 8B를 초당 16,960토큰으로 처리해 발표 당시 Nvidia GPU보다 48배, Cerebras …
출처: news.hada.io · https://news.hada.io/topic?id=32224
답글 남기기