익명 사용자
로그인하지 않음
토론
기여
계정 만들기
로그인
IT 위키
검색
도움말
모델 양자화: 편집 역사
IT 위키
이름공간
문서
토론
더 보기
더 보기
문서 행위
읽기
편집
원본 편집
역사
이 문서의 기록 보기
특정판 필터링
펼치기
접기
끝 날짜:
태그
필터:
wikieditor (숨긴 태그)
넘겨주기 대상 변경
넘겨주기 제거
대체됨
되돌려진 기여
비우기
새 넘겨주기
수동 되돌리기
시각 편집
시각 편집: 전환됨
일괄 되돌리기
편집 취소
판 보이기
차이 선택: 비교하려는 판의 라디오 버튼을 선택한 다음 엔터나 아래의 버튼을 누르세요.
설명:
(최신)
= 최신 판과 비교,
(이전)
= 이전 판과 비교,
잔글
= 사소한 편집
2025년 6월 15일 (일)
최신
이전
09:52
2025년 6월 15일 (일) 09:52
인공무능
토론
기여
3,790 바이트
+1,189
편집 요약 없음
편집 취소
태그
:
시각 편집: 전환됨
최신
이전
06:44
2025년 6월 15일 (일) 06:44
인공무능
토론
기여
2,601 바이트
+2,601
새 문서: 모델 양자화(模型量子化, Model Quantization)는 딥러닝 모델의 수치 표현 정밀도를 낮춰 메모리 사용량과 연산량을 줄이는 최적화 기법이다. 주로 대형 언어 모델(LLM)이나 모바일·엣지 디바이스에서 효율적인 추론을 위해 사용된다. ==개요== 딥러닝 모델은 일반적으로 32비트 부동소수점(float32)으로 학습되지만, 추론 시에는 16비트(float16), 8비트(int8), 4비트(int4) 등 더 낮...
태그
:
시각 편집
둘러보기
둘러보기
대문
최근 바뀜
광고
위키 도구
위키 도구
Atom
특수 문서 목록
문서 도구
문서 도구
사용자 문서 도구
더 보기
여기를 가리키는 문서
가리키는 글의 최근 바뀜
문서 정보
문서 기록