Cross-Modal Retrieval and Semantic Refinement for Remote Sensing Image Captioning
Two-stage remote sensing image captioning (RSIC) methods have achieved promising results by incorporating additional pre-trained remote sensing tasks to extract supplementary information and improve caption quality. However, these methods face limitations in semantic comprehension, as pre-trained de...
Uloženo v:
| Hlavní autoři: | , , , , |
|---|---|
| Médium: | Artigo |
| Jazyk: | Inglês |
| Vydáno: |
MDPI AG
2024-01-01
|
| Edice: | Remote Sensing |
| Témata: | |
| On-line přístup: | https://www.mdpi.com/2072-4292/16/1/196 |
| Tagy: |
Žádné tagy, Buďte první, kdo vytvoří štítek k tomuto záznamu!
|
