Похоже, теорема о том, что нейросети — это наше зеркало, получила научное подтверждение. Исследование Microsoft и Salesforce на 200 000 диалогов показало неприятную вещь. Чем дольше вы общаетесь с чат-ботом в одной ветке, тем выше шанс, что он начнет нести чепуху.
Статус новости — подтверждено. Ученые прогнали топовые модели вроде GPT-4.1 и Claude 3.7 через длинные сессии и увидели, как точность падает с бодрых 90% до вялых 65%. Проблема в том, что боты цепляются за свои первые ответы и начинают на них накручивать новые галлюцинации. Текст раздувается на ровном месте, а реального смысла становится меньше.
На мой взгляд, тут есть и ироничный подтекст. Мы привыкли винить алгоритмы, но Microsoft намекает, что наши путаные вопросы тоже сбивают ИИ с толку. В итоге получается замкнутый круг — бот пытается угадать ответ, не дочитав промпт, и вязнет в собственном многословии. Пользоваться ИИ вместо поиска сейчас — это осознанный риск получить уверенную ложь вместо факта.












