깃허브 트렌드
딥러닝 모델 최적화 라이브러리
양자화, 전이 학습, 가지치기, 신경망 구조 탐색, 추측 디코딩 기법을 적용해 모델을 압축한다. TensorRT-LLM, vLLM 등 배포 프레임워크에서 추론 속도를 높인다.
깃허브에서 보기 → · 오늘 판