Hardware-Friendly Fully Quantized Mamba-2 Model and Its FPGA-Based Accelerator
In this paper, we propose a fully quantized Mamba-2 model to enable efficient large language model (LLM) processing for edge AI. As a promising next-generation architecture, Mamba offers a scalable alternative to Transformer-based models with better suitability for edge AI. In the proposed model, th...
-д хадгалсан:
| Үндсэн зохиолчид: | , |
|---|---|
| Формат: | Artigo |
| Хэл сонгох: | Inglês |
| Хэвлэсэн: |
IEEE
2026-01-01
|
| Цуврал: | IEEE Access |
| Нөхцлүүд: | |
| Онлайн хандалт: | https://ieeexplore.ieee.org/document/11534219/ |
| Шошгууд: |
Шошго байхгүй, Энэхүү баримтыг шошголох эхний хүн болох!
|
