Сомнительные данные в моделях ИИ для прогнозирования здоровья

Недавние исследования показали, что десятки моделей искусственного интеллекта, предназначенных для оценки риска инсульта и диабета, базируются на данных с неясным происхождением. Как сообщает журнал Nature, команда под руководством Адриана Барнетта из Квинслендского технологического университета изучила 124 рецензируемые публикации, использующие два набора данных, загруженные на платформу Kaggle. Первый из них, посвященный инсульту, включает информацию о 5 110 пациентах, однако исследователи отметили отсутствие пробелов в данных, что вызывает подозрения. Второй набор, касающийся диабета, содержит всего 18 уникальных значений уровня глюкозы для 100 000 участников. Эти данные также оказались под сомнением. Специалисты предупреждают, что использование недостоверных данных может привести к неверным медицинским решениям. Журнал Scientific Reports уже отозвал три статьи из-за сомнений в достоверности информации.