SR-VLN: Implicit Spatial Reasoning Vision-and-Language Navigation
Vision-and-language navigation (VLN) traditionally relies on explicit reasoning chains, which, despite being interpretable, impose severe constraints on inference efficiency and scalability in long-range environments. Existing multimodal large language models (MLLMs) frequently encounter latency bot...
Na minha lista:
| Principais autores: | , , |
|---|---|
| Formato: | Artigo |
| Idioma: | Inglês |
| Publicado em: |
MDPI AG
2026-06-01
|
| coleção: | Sensors |
| Assuntos: | |
| Acesso em linha: | https://www.mdpi.com/1424-8220/26/12/3809 |
| Tags: |
Sem tags, seja o primeiro a adicionar uma tag!
|
