Исследование показывает, что ChatGPT допускает ошибки при создании планов лечения рака

Пост опубликован в блогах iXBT.com, его автор не имеет отношения к редакции iXBT.com
| Новость | ИИ, сервисы и приложения

ChatGPT активно внедряется во многие сферы нашей жизни, однако новое исследование предполагает, что есть одна ключевая область, где его использование вряд ли будет актуальным в ближайшее время. Исследователи из «Brigham and Women's Hospital» — учебной больницы Медицинской школы Гарварда в Бостоне, обнаружили, что планы лечения рака, созданные революционным чат-ботом от OpenAI, содержали множество ошибок.

Источник: www.businessinsider.com

Согласно исследованию, опубликованному в журнале JAMA Oncology, при запросе на создание планов лечения для различных случаев рака, треть ответов большой языковой модели содержали неверную информацию. Исследование также отметило, что чат-бот имел тенденцию смешивать правильную и неправильную информацию так, что становилось сложно определить, что является точным. Из общего числа 104 запросов около 98% ответов ChatGPT содержали хотя бы одно рекомендованное лечение, соответствующее рекомендациям Национальной комплексной сети по борьбе с раком (National Comprehensive Cancer Network), говорится в отчете.

Ответы чат-бота часто звучат уверенно и имеют логику, и то, как он может смешивать неправильную и правильную информацию, потенциально опасно. Даже эксперту трудно определить, какая рекомендация неверна"

соавтор исследования Даниэль Биттерман

ChatGPT получил ошеломительный успех с момента своего старта в ноябре 2022 года, достигнув 100 миллионов активных пользователей через два месяца после дебюта. Чат-бот вызвал бурный приток инвестиций в компании по искусственному интеллекту и ожесточенные дебаты о долгосрочном влиянии искусственного интеллекта.

Несмотря на успех ChatGPT, генеративные модели искусственного интеллекта все еще подвержены «галлюцинациям», когда они уверенно представляют информацию, которая вводит в заблуждение или крайне неверна. Хотя попытки интегрировать искусственный интеллект в здравоохранение, прежде всего для оптимизации административных задач, уже идут полным ходом. Ранее в этом месяце большое исследование показало, что использование искусственного интеллекта для скрининга рака груди является безопасным и может почти наполовину уменьшить нагрузку на радиологов.

Специалист по информатике из Гарварда недавно обнаружил, что GPT-4, последняя версия модели, может успешно сдать экзамен на медицинское лицензирование в США — и предположил, что у нее лучшие клинические оценки, чем у некоторых врачей. Тем не менее, проблемы с точностью генеративных моделей, таких как ChatGPT, означают, что они вряд ли в ближайшее время займут место врачей.

Источник: https://www.businessinsider.com/

Автор не входит в состав редакции iXBT.com (подробнее »)
Об авторе
Нейрофилософ. Пишу статьи на темы будущего, искусственного интеллекта и науки. Рассуждаю о том, как существовать в новом мире.
Полный перечень статей можно найти на моем сайте Блог Илона Мерлина
Присоединяйтесь в ТГ канал. Там представлен сборник мыслей, инструкций и советов по адаптации к миру будущего. Кодекс Мерлина

3 комментария

Добавить комментарий

MaxV
Безусловно, AI и подобные чат-боты имеют потенциал, но как и любое новое технологическое решение, они требуют тщательной проверки и валидации. На данном этапе я бы рассматривала их не как замену профессиональному мнению специалистов, а как инструмент дополнительной помощи. Важно помнить, что в медицинских вопросах каждая деталь имеет значение, и мы не должны полагаться исключительно на машины.
s
Все любят халяву, если машина может выполнять чужую работу почти бесплатно все сразу же на неё пересаживаютмя, сколько уже случаев где и адвокаты и известные художники пользовались и поменяли свою работу. Как доп помощник никто не будет использовать халяву даже если он на треть ошибается. Бональная лень людей одержит верх
db10993f565702129b84931fcfd0a778@livejournal
Кто вообще додумался… это же безмозглый попугай :> «Китайская комната»…

Добавить комментарий

Сейчас на главной

Новости

Публикации

Какие марки колбасы получили высокие оценки Роскачества и когда их проверяли

В сентябре 2026 года мне попались публикации о лучших марках колбасы по версии Роскачества. В списках повторялись «Окраина», «Снежана», «Пит-Продукт», «Мираторг». Сначала я собиралась выписать...

Мы четыре недели собирали продуктовый ролик в Google Vids, Runway и Hailuo. Почему интерфейс пришлось монтировать вручную

Нейросети довольно легко создавали для нас красивое видео с нуля. Проблемы начинались в тот момент, когда в ролике должен был появиться наш настоящий продукт.Не абстрактное приложение с...

Обзор повербанка Ugreen Wavy 10 000 мА·ч с мощностью до 45 Вт: легкий карманный вариант на каждый день

Повербанки сейчас можно условно разделить на 2 категории: крупные, мощные и емкие — для резервного питания ноутбука и других устройств, а также легкие и компактные — для...

Газотурбинный Chrysler проехал миллион километров по США, ездил на духах, но в серию не пошёл

В конце 1963 года на улицы США вышел уникальный автомобиль, который смог удивить прохожих своим необычным звуком. Вместо привычного глухого рычания бензинового ДВС слышался свист газотурбинной...

Железное кольцо Фарадея: как опыт 1831 года привёл к появлению трансформаторов

Если снять крышку с обычного блока питания, внутри почти наверняка найдётся трансформатор: сердечник и несколько обмоток провода. Его история начинается с железного кольца, которое Майкл Фарадей...

«Сатурн-201»: советский катушечный магнитофон из Омска

В советское время купить катушечный магнитофон было непросто: дефицит! Однако, иногда эти аппараты появлялись на прилавках, при этом основная масса покупателей, как правило, отдавала предпочтение...