Código QR

DeepSeek-R1 outperforms Gemini 2.0 Pro, OpenAI o1, and o3-mini in bilingual complex ophthalmology reasoning

Purpose: To evaluate the accuracy and reasoning ability of DeepSeek-R1 and three recently released large language models (LLMs) in bilingual complex ophthalmology cases. Methods: A total of 130 multiple-choice questions (MCQs) related to diagnosis (n ​= ​39) and management (n ​= ​91) were collected...

Descripción completa

Guardado en:
Detalles Bibliográficos
Autores principales: Pusheng Xu, Yue Wu, Kai Jin, Xiaolan Chen, Mingguang He, Danli Shi
Formato: Artigo
Lenguaje:Inglês
Publicado: Elsevier 2025-08-01
Colección:Advances in Ophthalmology Practice and Research
Materias:
Acceso en línea:http://www.sciencedirect.com/science/article/pii/S2667376225000290
Etiquetas: Agregar Etiqueta
Sin Etiquetas, Sea el primero en etiquetar este registro!