QR код

Hardware-Friendly Fully Quantized Mamba-2 Model and Its FPGA-Based Accelerator

In this paper, we propose a fully quantized Mamba-2 model to enable efficient large language model (LLM) processing for edge AI. As a promising next-generation architecture, Mamba offers a scalable alternative to Transformer-based models with better suitability for edge AI. In the proposed model, th...

Бүрэн тодорхойлолт

-д хадгалсан:
Номзүйн дэлгэрэнгүй
Үндсэн зохиолчид: Hiroshi Fuketa, Masakazu Hioki
Формат: Artigo
Хэл сонгох:Inglês
Хэвлэсэн: IEEE 2026-01-01
Цуврал:IEEE Access
Нөхцлүүд:
Онлайн хандалт:https://ieeexplore.ieee.org/document/11534219/
Шошгууд: Шошго нэмэх
Шошго байхгүй, Энэхүү баримтыг шошголох эхний хүн болох!