Codice QR

Towards vision-language models for cardiac surgery lecture videos

Vision-language models represent an emerging paradigm that leverages natural language to train vision systems with broad capabilities. Recently, the use of surgical lecture videos has emerged as a promising method for developing models capable of understanding surgical scenes. In this work, we aim t...

Descrizione completa

Salvato in:
Dettagli Bibliografici
Autori principali: Kostiuchik Georgii, Chen Jimmy, Farag Mina, Romano Gabriele, Karck Matthias, Arif Rawa, Grieshaber Philippe, Engelhardt Sandy
Natura: Artigo
Lingua:Inglês
Pubblicazione: De Gruyter 2025-12-01
Serie:Current Directions in Biomedical Engineering
Soggetti:
Accesso online:https://doi.org/10.1515/cdbme-2025-0311
Tags: Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!