Código QR (código de barras bidimensional)

Cap4Bridge: Caption-Guided Cross-Modal Contextualization With Stochastic Augmentation for Text-Video Retrieval

A key challenge in text-video retrieval is bridging the semantic gap between information-rich videos and concise text queries. Existing methods often address this by incorporating auxiliary captions from Large Language Models (LLMs) or employing stochastic modeling. However, these approaches face cr...

Fuld beskrivelse

Na minha lista:
Bibliografiske detaljer
Principais autores: Minju Jeon, Hyungee Kim, Si-Woo Kim, Youngtaek Oh, Soeun Lee, Dong-Jin Kim
Format: Artigo
Sprog:Inglês
Udgivet: IEEE 2026-01-01
Serier:IEEE Access
Fag:
Online adgang:https://ieeexplore.ieee.org/document/11474843/
Tags: Tilføj Tag
Ingen Tags, Vær først til at tagge denne postø!