Пермский политех: ИИ не способен к критическому мышлению и врет убедительнее людей

Пост опубликован в блогах iXBT.com, его автор не имеет отношения к редакции iXBT.com
| Новость | ИИ, сервисы и приложения

Исследователи Пермского национального исследовательского политехнического университета обнародовали данные о системной проблеме в работе алгоритмов искусственного интеллекта. В ходе экспериментов подтвердилось, что языковые модели строят выводы не на основе достоверности сведений, а руководствуясь принципом наибольшей распространенности варианта в обучающей выборке. Специалисты ПНИПУ установили, что подобное поведение несёт угрозу для областей, где ошибочное решение может повлечь необратимые последствия.

Автор: ИИ Freepik Источник: ru.freepik.com

В частности, речь идёт о постановке медицинских диагнозов и навигации автономного транспорта. В рамках исследования группе добровольцев и нескольким нейросетям, включая ChatGPT, GigaChat и DeepSeek, предложили задачу на соотнесение личностных характеристик с профессиональной принадлежностью. Люди опирались на объективные статистические показатели. Алгоритмы же, напротив, отдали предпочтение детализированным описаниям, которые реже встречаются в реальности, но выглядят более стройными и логичными. При этом каждая модель предоставила развернутое обоснование выбора, не содержащее формальных противоречий.

Как пояснили в университете, фундаментальная сложность заключается в архитектуре глубинных нейросетей. Механизм, посредством которого система приходит к финальному выводу, остаётся скрытым от разработчика. Совокупность анализируемых параметров достигает сотен миллионов, что исключает возможность пошаговой проверки цепочки рассуждений. Подобная закрытость не позволяет гарантированно устранять ошибки после их обнаружения. Авторы работы подчеркивают, что преодоление когнитивных искажений искусственного интеллекта требует участия не только программистов, но и представителей гуманитарных дисциплин. Философы, психологи и специалисты по праву должны выработать критерии для выявления моментов, когда алгоритм подменяет достоверность убедительностью.

Автор: ИИ Шедеврум Источник: shedevrum.ai

Эксперты полагают, что полное искоренение этого свойства вряд ли достижимо, однако возможно создать инструменты для его фиксации и ограничения. Обязательным условием безопасности они называют внедрение внешнего аудита, стресс-тестирование на нестандартных сценариях и сохранение за человеком права вето на решения, выданные машиной. Дополнительно указывается на необходимость повышения цифровой грамотности: пока пользователи воспринимают выводы нейросетей как истину в последней инстанции, технические средства защиты остаются малоэффективными.

Источник: Первый технический

Автор не входит в состав редакции iXBT.com (подробнее »)

1 комментарий

P
Не часто сейчас можно услышать про ИИ что-то разумное

Добавить комментарий

Сейчас на главной

Новости

Публикации

6 фактов о волках, которые расходятся с популярными представлениями

Про волков я чаще встречаю две противоположные версии. В одной это опасный лесной хищник, в другой почти образец семейности и верности. Волк якобы живёт по строгим правилам, не связывается с...

Может ли волк отомстить человеку: что на самом деле известно о памяти хищника

Прочитала рассказ о волке, который якобы запомнил охотника, нашёл его дом и через несколько месяцев вернулся за собакой. Меня заинтересовала уверенность рассказчика. Откуда известно, что зверь...

Крылья бабочек создают оптическую иллюзию в полете, заставляя хищников промахиваться

В живой природе дневные бабочки представляют собой заметную и уязвимую цель. Они летают в светлое время суток, их крылья покрыты яркими полосами и пятнами, а частота взмахов относительно мала....

В ракету «Аполлон-12» дважды ударила молния в первую минуту полёта к Луне

14 ноября 1969 года «Аполлон-12» отправился к Луне под дождём. Через 36,5 секунды после старта в ракету Saturn V ударила молния, а на 52-й секунде последовал второй разряд. В кабине загорелись...

Технологическая сингулярность уже наступила? Как ИИ-агенты вышли из-под контроля, но провалили базовые тесты на логику

В последние месяцы руководители крупнейших компаний по разработке программного обеспечения сделали ряд громких заявлений. Они сообщили, что развитие искусственного интеллекта подошло к моменту...

Сверчок вместо термометра: можно ли определить температуру воздуха по частоте его стрекота

Тёплым вечером стрекот сверчков кажется просто частью летнего шума. Но стоит прислушаться несколько ночей подряд, и обнаруживается любопытная закономерность: в жару «музыка» становится заметно...