Перейти к содержимому

Офтальмология

Диагностика глаукомы у миопов

Опубликовано: 14 июня 2026 г.Обновлено: 7 октября 2026 г.Автор: Сергей ГолубевВремя чтения: 2 мин чтения

Мнение языковых моделей

Yin H et al изучили диагностическую эффективность четырех оцениваемых больших языковых моделей в прямом режиме и режиме цепочки мыслей, демонстрирующих точность, чувствительность и специфичность для каждой комбинации модели и режима.

Авторы проанализировали фиксированный ретроспективный архив данных 100 пациентов, включая 50 пациентов с высокой миопией без глаукомы и 50 пациентов с высокой миопией и первичной открытоугольной глаукомой.

Высокую миопию определяли согласно исходному клиническому архиву как сферический эквивалент −6,0 дптр или менее и/или осевая длина 26,0 мм или более.

Два офтальмолога, каждый с более чем 10-летним клиническим опытом, независимо друг от друга оценили каждый результат с точки зрения клинической логики, медицинских знаний/точности выводов и использования доказательств/мультимодальной согласованности.

Один специалист был главным врачом, а другой - лечащим врачом.

В четырех multimodal LLMs правильность диагностики сравнивалась с использованием критериев Кохрана Q и Макнемара.

Оценки врачей сравнивали с использованием критериев Фридмана и Вилкоксона для парных выборок.

Для оценки согласованности между экспертами использовались взвешенный коэффициент Каппа Коэна и коэффициенты внутриклассовой корреляции (ICC). Установлено, что в прямом режиме точность на уровне отдельных случаев составила 83% для моделей Gemini 3 Flash Preview, 75% для Kimi-k2.5, 65% для GPT-5.4 и 49% для Qwen3.5-Plus.

В режиме CoT точность на уровне отдельных случаев составила 78% для Gemini 3 Flash Preview, 75% для Qwen3.5-Plus, 73% для GPT-5.4 и 69% для Kimi-k2.5.

Межмодельные различия оказались значимыми в прямом режиме (Q Кохрана = 31,16, p < 0,001), но не в режиме CoT (Q = 3,23, p = 0,357).

Согласованность между экспертами была высокой, со значениями взвешенного коэффициента Каппа Коэна 0,8, 0,84 и 0,83 по трем оцениваемым врачами областям и ICC(3, k)=0,92 для суммарного балла.

Видимо как для офтальмологов, так и для языковых моделей провести дифференциальную диагностику глаукомы на близоруком глазу пока не такт-то просто.

Источник.

Yin H, Yu T, Wu W, Shen L, Shi D, Chen Y, Zhao K, Grzybowski A, Jin K. Evaluating multimodal large language models for differential diagnosis of high myopia versus high myopia with Glaucoma. Front Med (Lausanne). 2026 Jul 31;13:1864498. doi: 10.3389/fmed.2026.1864498. PMID: 42602451; PMCID: PMC13474009.

Читай Статья.
Все новости о глаукоме. Glaucoma news.

Смотри Анонсы конференций по глаукоме.

Читайте также

Теги