SQUAD: A Scalable Quantization Accelerator Toward Energy-Efficient On-Device Quantization-Aware Training
Quantization-aware training (QAT) is a crucial technique for maintaining model accuracy at extremely low-bit precision (i.e., 4-bit or lower). However, the fake quantization operation of QAT introduces significant training time overhead compared to post-training quantization (PTQ). To address this c...
Збережено в:
| Автори: | , , |
|---|---|
| Формат: | Artigo |
| Мова: | Inglês |
| Опубліковано: |
IEEE
2025-01-01
|
| Серія: | IEEE Access |
| Предмети: | |
| Онлайн доступ: | https://ieeexplore.ieee.org/document/11155087/ |
| Теги: |
Немає тегів, Будьте першим, хто поставить тег для цього запису!
|
