реклама
Новости Software

ChatGPT был близок к сдаче экзамена на получение лицензии врача в США

Алгоритм большой языковой модели (LLM) ChatGPT компании OpenAI почти сдал экзамен на получение лицензии врача в США. Это очень сложное испытание для кандидата-человека, но ИИ-бот оказался близок к сдаче экзамена без обучения с подтверждением — на базе одного лишь поиска информации в интернете. Впрочем, лечить людей с его помощью пока никто не собирается, хотя этому помешает скорее юридическая сторона проблемы, а не практическая.

 Источник изображения: Pixabay

Источник изображения: Pixabay

Алгоритм ChatGPT уже удивил способностью писать программный код, сдачей экзамена в бизнес-школу и другими интеллектуальными штучками. Попытка сдать экзамен US Medical Licensing Exam (USMLE) стала очередным достижением машинного алгоритма. Человеку соискателю требуются от 300 до 400 часов подготовки для сдачи этого экзамена, фактически состоящего из трёх разделов. Способность ChatGPT научиться связно и по теме давать ответы на экзаменационные вопросы USMLE позволяет надеяться, что когда-нибудь ИИ сможет либо сам давать медицинские консультации, либо, что более вероятно, станет помощником врача для постановки более точных диагнозов.

«ChatGPT показал результаты на уровне или близком к порогу сдачи всех трёх экзаменов без какого-либо специального обучения или подкрепления, — пишут исследователи в опубликованной работе. — Кроме того, ChatGPT продемонстрировал высокий уровень согласованности и проницательности в своих объяснениях».

Исследование провели специалисты из стартапа Ansible Health. Предварительно было выяснено, что прямых ответов на вопросы USMLE в интернете нет. Таким образом, ChatGPT генерировал новые ответы на основе данных, полученных им по теме вопросов.

При проходном балле в районе 60 % правильных ответов на все вопросы, ChatGPT набрал от 52,4 % до 75 % по всем трём экзаменам. В 88,9 % ответов алгоритм выдавал как минимум один значимый ответ, который исследователи квалифицировали как «новый и неочевидный хотя клинически обоснованный».

«Достижение проходного балла на этом печально известном сложном экспертном экзамене, причём без какого-либо человеческого подкрепления, знаменует собой заметную веху в развитии клинического ИИ», — говорится в заявлении авторов исследования для прессы.

Более того, в точности ответов ChatGPT на 50,3 % обошёл специально обученного для ответов на такие вопросы медицинский ИИ PubMedGPT. Что же будет, если специалист-человек натаскает ChatGPT на медицинскую квалификацию?

Источник:

Если вы заметили ошибку — выделите ее мышью и нажмите CTRL+ENTER.
Вечерний 3DNews
Каждый будний вечер мы рассылаем сводку новостей без белиберды и рекламы. Две минуты на чтение — и вы в курсе главных событий.
Материалы по теме
window-new
Soft
Hard
Тренды 🔥
Motorola и Google объединились для внедрения ИИ-функций в смартфоны Razr 3 ч.
Браузер Firefox версии Nightly получил ИИ-помощников ChatGPT и Gemini 5 ч.
Google решила убрать бесконечную прокрутку результатов поиска 5 ч.
Политические дипфейки оказались самой популярным направлением в злоупотреблениях ИИ 10 ч.
Forza Horizon 4 скоро снимут с продажи и удалят из Game Pass — подробности и причины 11 ч.
Игровая студия стримера Dr Disrespect разорвала с ним отношения — выяснилась причина его вечного бана на Twitch 11 ч.
Еженедельный чарт Steam: Elden Ring, новый кооперативный хит Chained Together и MMORPG от создателя EVE Online 12 ч.
Спустя три года фанаты дождались анонса Farming Simulator 25 — дата выхода, первый трейлер и предзаказ в российском Steam 13 ч.
Apple включила RCS на iPhone с выпуском второй беты iOS 18, но работает функция пока не у всех 14 ч.
Сборник S.T.A.L.K.E.R. Legends of the Zone Trilogy на PlayStation и Xbox получил официальную поддержку модов 15 ч.
Прототип китайской многоразовой ракеты впервые подпрыгнул на 12 км и мягко приземлился 19 мин.
Данные стали «валютой» для ИИ, но для их обработки нужно немало реальной валюты 2 ч.
Мероприятие Made by Google состоится 13 августа — покажут смартфоны Pixel 9 и другие новинки 2 ч.
SMIC не сможет выпускать достаточно передовых 7-нм чипов для Huawei из-за нехватки оборудования и оснастки 2 ч.
Waymo приступила к перевозкам на беспилотных такси на всей территории Сан-Франциско 3 ч.
Власти Южной Кореи в июле начнут распределять $19 млрд субсидий в полупроводниковом секторе 4 ч.
Новая статья: Обзор смартфона Infinix NOTE 40 Pro+ 5G: главарь банды 8 ч.
Etched Sohu — самый быстрый в мире ИИ-ускоритель, но только для трансформеров 9 ч.
Новая статья: Обзор ноутбука OSiO FocusLine F160a: уверенные первые шаги 10 ч.
Самолёты можно питать с помощью микроволнового излучения прямо в полёте, но сделать это крайне трудно 12 ч.