주요 콘텐츠로 건너뛰기
지식 기술 자료

최적의 인텔/신경망 압축 프레임워크(NNCF)를 사용한 중량 압축에서 FP16 모델을 선택해야 하는 이유는 무엇입니까?

콘텐츠 형태: 문제 해결   |   문서 ID: 000098174   |   마지막 검토일: 2024-03-21

설명

Optimum Intel / NNCF를 사용한 중량 압축에서 FP16 모델을 선택한 이유를 확인할 수 없습니다.

해결 방법

FP32 정밀도의 모델 크기를 절반으로 줄인 FP16 반정밀도는 GPU 리소스의 절반을 사용하면서도 거의 동일한 추론 결과를 얻을 수 있습니다.

관련 제품

이 문서는 3개의 제품에 적용됩니다.
인텔® 제온 Phi™ 프로세서 소프트웨어 OpenVINO™ toolkit 성능 라이브러리

부인 정보

이 페이지의 콘텐츠는 원본 영어 콘텐츠에 대한 사람 번역 및 컴퓨터 번역의 조합으로 완성되었습니다. 이 콘텐츠는 편의와 일반적인 정보 제공을 위해서만 제공되었으며, 완전하거나 정확한 것으로 간주되어선 안 됩니다. 이 페이지의 영어 버전과 번역 간 모순이 있는 경우, 영어 버전이 우선적으로 적용됩니다. 이 페이지의 영어 버전을 확인하십시오.

추가적 도움이 필요하십니까?

지원팀 연락처
지원팀 연락처