Código QR (código de barras bidimensional)

SR-VLN: Implicit Spatial Reasoning Vision-and-Language Navigation

Vision-and-language navigation (VLN) traditionally relies on explicit reasoning chains, which, despite being interpretable, impose severe constraints on inference efficiency and scalability in long-range environments. Existing multimodal large language models (MLLMs) frequently encounter latency bot...

ver descrição completa

Na minha lista:
Detalhes bibliográficos
Principais autores: Ruolin Zhu, Shaobin Li, Min Yang
Formato: Artigo
Idioma:Inglês
Publicado em: MDPI AG 2026-06-01
coleção:Sensors
Assuntos:
Acesso em linha:https://www.mdpi.com/1424-8220/26/12/3809
Tags: Adicionar Tag
Sem tags, seja o primeiro a adicionar uma tag!