* * *
© Санкт-Петербургский государственный университет, 2023
Введение
Объем знаний в мире огромен и продолжает стремительно увеличиваться. При этом в большинстве знания разнородны, не отформатированы, не структурированы и постоянно изменяются. В таких условиях крайне важно найти способы эффективно анализировать и применять имеющиеся знания, в том числе неполные и неточные. Эту задачу решают технологии, основанные на использовании искусственного интеллекта (далее – ИИ).
В настоящее время применение ИИ в разных сферах жизни общества, в том числе здравоохранении, становится уже привычным. Развитие ИИ наряду с другими элементами цифрового здравоохранения, например интернетом вещей, телемедициной, способствует повышению качества и доступности медицинской помощи.
Медицинское сообщество находится на заре новой эры, когда ИИ начинает внедряться в повседневную клиническую практику. Технологии искусственного интеллекта в здравоохранении активно развиваются, что требует создания полноценного правового регулирования всего жизненного цикла ИИ, от разработки до контроля за его применением. Глобальной сейчас является проблема почти полного отсутствия подобного регулирования. Только отдельные государства, в том числе Российская Федерация, проводят системную работу по созданию нормативной базы в области ИИ.
В формирующемся регулировании применения ИИ ключевую роль играет соблюдение безопасности и базовых этических принципов. Понимание возможностей и ограничений, связанных с использованием ИИ при оказании медицинских услуг, а также основных требований в сфере обращения медицинских изделий (далее – МИ) необходимо для эффективной работы организаторов здравоохранения.
Настоящее учебное пособие предназначено для самоподготовки студентов медицинских высших учебных заведений, а также ординаторов по дисциплине «Общественное здоровье и здравоохранение».
Раздел 1
Технологии искусственного интеллекта
§ 1. Общие положения
Концепция использования компьютерных технологий для имитации мышления и разумного поведения была впервые описана Аланом Тьюрингом (Alan Mathison Turing) в 1950 г. Основной научной задачей являлось изучение работы человеческого мозга. Шесть лет спустя Джон Маккарти (John McCarthy) дал определение термина «искусственный интеллект» (artificial intelligence, AI): наука и техника создания интеллектуальных машин, особенно интеллектуальных компьютерных программ.
В начале 1980-х годов ученые, занимающиеся теорией вычислений, Барр (Valerie Barr) и Файгенбаум (Edward Albert Feigenbaum) предложили такое определение искусственного интеллекта: «область информатики, которая занимается разработкой интеллектуальных компьютерных систем, то есть систем, обладающих возможностями, которые мы традиционно связываем с человеческим разумом, – понимание языка, обучение, способность рассуждать, решать проблемы и т. д.»[1].
Суть создания ИИ заключается в том, чтобы сформировать систему, которая смогла бы автономно работать, решая интеллектуальные задачи по подобию когнитивных процессов у человека. Разработка данной системы основана на таких дисциплинах, как математика, компьютерные науки, биология, физиология, психология, лингвистика и др.
Основой ИИ являются алгоритмы, которые транслируются в компьютерный код, содержащий инструкции для быстрого анализа и преобразования данных в выводы, информацию или другие выходные данные.
В настоящее время в России ИИ определяется как комплекс технологических решений, позволяющих имитировать когнитивные функции человека (включая самообучение и поиск решений без заранее заданного алгоритма) и получать при выполнении конкретных задач результаты, сопоставимые как минимум с результатами интеллектуальной деятельности человека [Указ…, 2019].
Комплекс технологических решений включает в себя информационно-коммуникационную инфраструктуру, программное обеспечение, в том числе то, в котором используются методы машинного обучения, процессы и сервисы по обработке данных и поиску решений.
Система ИИ (artificial intelligence system) – программное обеспечение, в котором используются технологические решения ИИ.
Для понимания сути ИИ также важен ряд понятий и терминов, применяемых при описании технологий: данные, набор данных, большие данные (big data), аппаратное обеспечение, вычислительная система, база знаний (значение данных терминов см. в глоссарии, расположенном в конце учебного пособия).
Вычислительная система – предназначенный для решения задач и обработки данных (в том числе вычислений) программно-аппаратный комплекс или несколько взаимосвязанных комплексов, образующих единую инфраструктуру с ИИ, в отличие от программирования без ИИ может ответить не только на конкретные, но и на общие вопросы. Также возможна быстрая и простая модификация программы, в том числе частичная, не приводящая к изменению ее структуры.
Экспертная система – технология ИИ, позволяющая на основе базы знаний воспроизвести модель поведения экспертов в определенной области знаний, сократить время и трудозатраты пользователя на решение типовых задач. Характерными чертами экспертной системы являются:
– четкая ограниченность предметной области;
– способность принимать решения в условиях неопределенности;
– способность объяснять ход и результат решения понятным для пользователя способом;
– четкое разделение данных и механизмов вывода;
– способность пополнять базу данных;
– ориентация на решение неформализованных задач;
– отсутствие гарантий нахождения оптимального решения с возможностью учиться на ошибках;
– также то, что результат выдается в виде конкретных рекомендаций, не уступающих решениям лучших специалистов в конкретной области знаний;
– алгоритм решения не описывается заранее, а строится самой экспертной системой.
Сильнейшей стороной технологий ИИ стала способность к обучению.
Машинное обучение (machine learning, ML) – это использование определенных признаков при выявлении шаблонов для анализа конкретной ситуации. Машина может «учиться» (обучение по прецедентам (индуктивное обучение)) и применять эту информацию в будущих подобных сценариях. Этот инструмент прогнозирования можно, например, применять динамически для клинических решений, чтобы персонализировать уход за пациентом, а не следовать статическому алгоритму. Модели улучшаются, обучаясь на представленных наборах данных. Машинное обучение использует определенное количество признаков и требует участия человека.
Машинное обучение развилось в широко известное глубокое обучение (deep learning) (в настоящее время считается одним из видов машинного обучения), состоящее из алгоритмов для создания искусственной нейронной сети (artificial neural network, ANN), которая затем может обучаться, в том числе самостоятельно классифицировать данные, и принимать решения самостоятельно, подобно человеческому мозгу. Такое обучение основано на использовании многоуровневых моделей для постепенного извлечения признаков из большого объема данных.
Искусственная нейронная сеть – сеть элементов простейшей обработки, соединенных взвешенными связями с регулируемыми весами, в которой каждый элемент производит значение, применяя к своим входным значениям нелинейную функцию, и передает его другим элементам или представляет его в виде выходного значения.
Сверточная нейронная сеть (convolutional neural network, CNN) – это тип алгоритма глубокого обучения, применяемого для обработки изображений, имитирующего поведение взаимосвязанных нейронов человеческого мозга. CNN состоит из нескольких слоев, которые анализируют входное изображение для распознавания шаблонов и создания определенных фильтров. Окончательный результат достигается за счет объединения всех функций полностью подключенных слоев. Сейчас доступно несколько алгоритмов CNN, включая Le-NET, AlexNet, VGG, GoogLeNet и ResNet.
Различные варианты нейронных сетей в виде упрощенных схем, позволяющих понять основные принципы их функционирования, показаны на рис. 1.
Рис. 1. Примеры нейронных сетей. Источник: [Van Veen F., Leijnen S. The Neural Network Zoo. 2019. https://www.asimovinstitute.org/neural-network-zoo (дата обращения: 09.09.2023)].
В настоящее время существуют различные типы и алгоритмы машинного обучения (рис. 2).
Рис. 2. Концепции ИИ и МО. Источник: [Machine Learning-enabled Medical Devices…, 2021].
Существует много алгоритмов машинного обучения, отличающихся возможностями и ограничениями. К принципиальным характеристикам, присущим тому или иному алгоритму ИИ, можно отнести [Глизница и др., 2022]:
1. Интерпретируемость – возможность установить основания принятого алгоритмом решения, открыть «черный ящик». Возможность объяснить решение, предлагаемое алгоритмом, значительно облегчает внедрение методов в медицинскую практику.
2. Устойчивость к мультиколлинеарности – корреляционной связи между независимыми переменными, которая негативно сказывается на времени обучения и точности результата. В частности, учет избыточного числа переменных из медицинской карты приводит к формированию слишком сложной модели с несущественными признаками заболевания (эффект переобучения), не способной к обобщению.
3. Возможность выбора переменных, позволяющая снизить эффект мультиколлинеарности. Например, если алгоритм учел в построенной математической модели и национальность, и расовую принадлежность пациента, то возможность вручную исключить один из параметров, не редактируя набор данных, значительно облегчит работу с системой.
К основным подходам машинного обучения можно отнести следующие:
– контролируемое машинное обучение (обучение с учителем, supervised machine learning), когда алгоритм ИИ наблюдает набор размеченных данных и обучается функции, позволяющей предсказывать аннотацию для новых входных данных;
– неконтролируемое машинное обучение (обучение без учителя, unsupervised machine learning), когда алгоритм распознает паттерны (структуру) в неразмеченных данных, выявляя скрытые закономерности.
Под разметкой данных (data labeling) понимается этап обработки структурированных и неструктурированных данных, в процессе которого данным (в том числе текстовым документам, фото- и видеоизображениям) присваиваются идентификаторы, отражающие их тип (классификация), и (или) осуществляется интерпретация данных для решения конкретной задачи.
Такие популярные алгоритмы глубокого обучения, как сверточные нейронные сети, глубокие сети доверия, рекуррентные нейронные сети и другие, лежат в основе услуг многих технологических гигантов.
В настоящее время перспективным направлением является построение алгоритмов ИИ на основе наиболее биологически достоверных моделей (выполнение нейроморфных вычислений, максимально приближенных к работе человеческого мозга). Спайковая нейронная сеть (spiking neural network, SNN) является одним из основных «кандидатов» для преодоления ограничений нейронных вычислений и эффективного использования алгоритма машинного обучения в реальных приложениях. Концепция вдохновлена механизмами взаимодействия между нейронами, основанными на передаче информации при помощи электрических импульсов, дискретных пространственно-временных сигналов (спайков). Спайковые нейронные сети построены на основе биологических методов обработки информации, где разреженные во времени асинхронные сигналы передаются и обрабатываются массово-параллельным образом. Они демонстрируют низкое энергопотребление и высокую скорость обработки информации [Taherkhani et al., 2020].
Принято также деление ИИ на слабый и сильный. Термин «сильный ИИ» впервые предложен в 1980 г. [Searle, 1980]. Теория сильного ИИ предполагает, что компьютеры могут становиться «разумными» в том смысле, в котором человеческий разум – это разум. Сильный ИИ постоянно занимается самообучением, не уступает человеку по интеллектуальным способностям, обладает самосознанием, может обрабатывать чувственную информацию [Малышева, Касимов, 2016].
Слабый ИИ не обладает такими возможностями.
В настоящее время деление на сильный и слабый ИИ является в определенной мере теоретическим, так как существующие технологии ИИ пока достаточно узкие по сравнению с человеческим разумом.
В последние годы активно обсуждается концепция гибридного интеллекта как интеграция человеческих способностей (естественного интеллекта) и потенциала алгоритмов ИИ.
В РФ к технологиям ИИ, т. е. технологиям, основанным на использовании ИИ, отнесены [Указ…, 2019]:
а) компьютерное зрение (CV) – процесс получения компьютером информации и ее понимание из серии изображений или видео;
б) обработка естественного языка (NLP) – извлечение данных из человеческой речи и принятие решений на основе этой информации;
в) распознавание и синтез речи;
г) интеллектуальная поддержка принятия решений;
д) перспективные методы ИИ.
При этом перспективными методами ИИ в настоящее время считаются методы, направленные на создание принципиально новой научно-технической продукции, в том числе в целях разработки универсального (сильного) ИИ. К перспективным методам ИИ относятся: автономное решение различных задач, автоматический дизайн физических объектов, автоматическое машинное обучение, алгоритмы решения задач на основе данных с частичной разметкой и (или) незначительных объемов данных, обработка информации на основе новых типов вычислительных систем, интерпретируемая обработка данных.
§ 2. История развития технологий искусственного интеллекта
Как технологическое явление ИИ берет свое начало в 1956 г., когда в Университете Дартмута (США) прошла рабочая конференция с участием таких ученых, как Джон Маккарти, Марвин Минский (Marvin Minsky), Клод Шеннон (Claude Shannon), Алан Тьюринг, которые были названы основателями сферы искусственного разума[2].
В последующие годы развитие ИИ неразрывно связано с созданием роботов. В 1966 г. в Стэнфордском научно-исследовательском институте был разработан Shakey – «первый электронный человек», первый мобильный робот, способный интерпретировать инструкции. Вместо того чтобы выполнять одношаговые команды, Shakey мог обрабатывать более сложные инструкции и выполнять соответствующие действия. Создание Shakey стало важной вехой для робототехники и ИИ [Kaul et al., 2020].
На смену экспертным системам, описывающим алгоритм действий по выбору решения в зависимости от конкретных условий, пришло машинное обучение, благодаря которому информационные системы самостоятельно формируют правила и находят решение на основе анализа зависимостей, используя исходные наборы данных. Нахождение решений без предварительного составления человеком их возможного перечня позволило говорить о настоящем прорыве в развитии ИИ.
Наиболее активно в прикладном смысле ИИ стал развиваться в 1990-е годы. Тогда, например, были созданы программы, которые позволили машине выигрывать у человека. В 1996 г. программа Deep Blue Chess обыграла гроссмейстера и чемпиона мира Гарри Каспарова[3].
Появление мощных графических процессоров и рост вычислительной мощности современных компьютеров, развитие облачных вычислений, взрывной рост больших данных позволили выполнять машинное обучение с высокой точностью.
В 2007 г. IBM создала открытую систему ответов на вопросы Watson, занявшую первое место в телевизионном игровом шоу Jeopardy в 2011 г. (в ситуациях конкуренции системы с людьми). В отличие от традиционных систем, которые использовали либо прямое рассуждение (следуя правилам от данных к выводам) и обратное (следуя правилам от выводов к данным), либо созданные вручную правила «если… то», эта технология, называемая DeepQA, применяла обработку естественного языка и различные поиски для анализа неструктурированного контента для получения вероятных ответов. Система оказалась доступна, проще в обслуживании и более рентабельна [Kaul et al., 2020].
В 2016 г. разработанная Google программа AlphaGo (технология машинного обучения DeepMind) одержала победу над Ли Седолем, чемпионом мира по игре в го. Успех программы стал толчком для того, чтобы в марте 2016 г. ее создатели заключили соглашение с Национальной службой здравоохранения Великобритании для изучения возможностей применения ИИ при осуществлении анализа медицинских данных [Отбеткина, 2022, с. 851].
В январе 2017 г. программа Libratus, разработанная в Университете Карнеги – Меллона, победила в 20-дневном покерном турнире «Brains Vs. Artifcial Intelligence: Upping the Ante»[4], что, безусловно, свидетельствует о качественном скачке в объемах производственных мощностей ИИ.
В настоящее время в мире происходит ускоренное внедрение технологий на основе ИИ в различные отрасли экономики и сферы общественных отношений, что, как ожидается, приведет к росту мировой экономики в 2024 г. не менее чем на 1 трлн долл. США.
Ускоренное внедрение технологий на основе ИИ обусловлено следующими факторами:
а) общий (сквозной) характер применения прикладных технологических решений;
б) высокая степень влияния технологий на основе ИИ на результативность деятельности организаций и человека, в том числе связанной с принятием управленческих решений;
в) высокая доступность инструментов (в том числе программ для ЭВМ с открытым кодом) для разработки технологий на основе ИИ;
г) потребность в обработке больших объемов данных, создаваемых как человеком, так и техническими устройствами, для повышения эффективности экономической и иной деятельности.
В 2018 г. мировой рынок технологических решений, разработанных на основе ИИ, составил 21,5 млрд долл. США и, по прогнозам экспертов, к 2024 г. достигнет почти 140 млрд долл. США [Указ…, 2019].
Наиболее популярными для внедрения ИИ считаются отрасли рекламы, маркетинга, торговли, банковского дела, страхования, промышленности, военного дела. Однако довольно быстро технологии ИИ добрались и до медицины. Стремительное развитие технологий на основе ИИ сопровождается существенным ростом как государственных, так и частных инвестиций в их развитие, а также в разработку прикладных технологических решений. По оценкам международных экспертов, инвестиции в такие технологии выросли с 2020 по 2021 г. более чем в два раза, составив около 67 млрд долл. США[5]. При этом интерес инвесторов к рынку технологий ИИ в здравоохранении – один из самых высоких (рис. 3).
Рис. 3. Рост инвестиций в технологии ИИ. Источник: [State of Al 2021 Report/ CBINSIGHTS. March 9. 2022. https://www.cbinsights.com/research/report/ai-trends-2021/(дата обращения: 22.10.2022), 2022].
Ведущие мировые технологические гиганты (Facebook[6], Google, Amazon, Apple, Microsof) вкладывают огромные денежные средства в разработку технологий ИИ для применения в своей бизнес-нише.
В России ИИ также активно развивается. Разработанные технологические решения на основе ИИ (например, компьютерное зрение и обработка естественного языка) уже сейчас обладают значительной коммерческой привлекательностью и высоким экспортным потенциалом на мировом рынке.