Código QR (código de barras bidimensional)

Assessing consistency of AI chatbot responses in ophthalmology medical exams

Purpose: Large language models (LLMs) are increasingly evaluated in ophthalmology, often using single test iterations that overlook whether responses remain consistent under repeated conditions. We aim to assess commonly used AI models under multiple testing iterations with varying conditions, inclu...

ver descrição completa

Na minha lista:
Detalhes bibliográficos
Principais autores: Elad Shvartz, Regina Raiyter, Amelia Goldshtein, Omri Zur, Eyal Margalit, Daniel Bahir
Formato: Artigo
Idioma:Inglês
Publicado em: Elsevier 2025-12-01
coleção:AJO International
Assuntos:
Acesso em linha:http://www.sciencedirect.com/science/article/pii/S2950253525000930
Tags: Adicionar Tag
Sem tags, seja o primeiro a adicionar uma tag!