APPERCASE
vasb@nccrepnfr.eh +7 499 302-34-17

Исследование на Тайване показало, что AI-чатботы ненадежны для клинических вопросов

Исследование в Тайване показало, что популярные AI-инструменты, такие как ChatGPT, имеют ограниченную точность при ответах на клинические вопросы, связанные с инсультом, что вызывает опасения по поводу их надежности в медицинских контекстах.

В Тайване проведено исследование, которое выявило, что популярные AI-инструменты, включая ChatGPT, демонстрируют низкую точность при ответах на клинические вопросы, связанные с инсультом. Это вызывает серьезные опасения относительно надежности больших языковых моделей в медицинских ситуациях.

Исследование, представленное ассоциированным профессором Национального университета Тайваня, оценивало работу AI на четырех этапах ухода за пациентами с инсультом. Учитывая, что все больше пациентов обращаются к интернету и AI за медицинской информацией, важно тщательно оценивать точность этих инструментов.

В ходе исследования тестировались модели ChatGPT-4o, Claude 3 Sonnet и Gemini Ultra 1.0 с использованием смоделированных клинических сценариев. Применялись три метода запроса: Zero-Shot Learning, Chain of Thought и Talking Out Your Thoughts. Оценивались ответы на предмет точности, наличия галлюцинаций, специфичности, эмпатии и возможности применения.

Большинство AI-моделей не смогли преодолеть порог клинической компетентности в 60 баллов из 100. Модели часто не предоставляли действенные рекомендации, особенно в критических ситуациях, связанных с лечением инсульта, где ошибки и неполные ответы были обычным делом.

Профессор Ли отметил, что хотя AI может быть полезен для получения общей информации о здоровье, он ненадежен в экстренных или высокострессовых ситуациях, требующих профессионального суждения. Включение личной информации, такой как возраст, пол, семейная медицинская история и использование медикаментов, может повысить релевантность ответов, генерируемых AI.

Врач Национального университета Тайваня также подчеркнул, что AI-инструменты должны использоваться только как дополнительные источники информации, а не заменять медицинских специалистов.

Исследование показало, что каждый метод запроса имеет свои сильные стороны. Среди трех моделей GPT-4o показал лучшие результаты по точности, специфичности и возможности применения. Однако большие языковые модели все еще имеют значительные ограничения в предоставлении клинически релевантных и действенных рекомендаций. Исследователи пришли к выводу, что информация о здоровье, генерируемая AI, может не всегда соответствовать клиническим стандартам, что подчеркивает необходимость осторожного подхода пациентов к этим ресурсам.

Эта новость создана искусственным интеллектом на основе открытых данных и предназначена исключительно для информирования. Администрация сайта не несёт ответственности за её содержание. Новости агрегируются из различных источников, включая недружественные России страны и их средства массовой информации. Социальные сети Facebook, Instagram и WhatsApp принадлежат корпорации Meta, которая в России признана экстремистской организацией.

Модель Qwen 3.6 продемонстрировала впечатляющие результаты при выполнении сложных задач программирования на локальном оборудовании, ставя под сомнение необходимость использования облачных AI-сервисов.
В округе Дуглас власти предупреждают пожилых людей о мошеннических видео на YouTube, вводящих в заблуждение относительно налоговых льгот на имущество. Эти ролики утверждают о новых программах помощи, но на самом деле это попытка заработать на кликах.
Создание AI-ассистента за 15 минут без программирования: новый подход к управлению бизнесом, который помогает сосредоточиться на главных задачах и избегать отвлечений.
Написать нам