ИИ при длительном общении с человеком тупеет

1076
12
Добавить в Google News
ИИ при длительном общении с человеком тупеет

Исследование Microsoft Research и Salesforce подтвердило, что при длительном общении языковые модели склонны к деградации. Аналитики изучили более 200 тысяч диалогов с участием GPT-4.1, Gemini 2.5 Pro, Claude 3.7 Sonnet, o3, DeepSeek R1 и Llama 4. Выяснилось, что при одиночных запросах точность ответов достигает 90%, но в многоходовых беседах падает до 65%.

Причина — так называемая «преждевременная генерация»: модели пытаются ответить, не дочитав сообщение до конца. В длинном диалоге ошибки накапливаются, а бот начинает опираться на собственные предыдущие ответы, даже если те были абсурдны. Также зафиксирован эффект «раздувания»: к концу разговора сообщения становятся длиннее на 20–300%, и чем больше слов, тем выше вероятность галлюцинаций. Модели с дополнительными токенами мышления вроде o3 и DeepSeek R1 также не справились с ловушкой.

Исследователи предупреждают: при детализации задач в долгой беседе велик риск принять за факты то, что нейросеть выдумала несколькими репликами ранее.

Комментировать
Другие публикации по теме
Биполярка, не иначе: Anthropic банит пользователей из России за то, что они из России, но при этом переводит интерфейс Claude на русский
Биполярка, не иначе: Anthropic банит пользователей из России за то, что они из России, но при этом переводит интерфейс Claude на русский
Пользователи популярного ИИ-сервиса Claude обратили внимание на появление русскоязычной локализации в настройках аккаунта.
7 октября в 12:05
567
4
Форум
Четыре NVIDIA DGX Spark за $40 000 смогли запустить DeepSeek V4.1-Flash почти на скорости Cerebras
Четыре NVIDIA DGX Spark за $40 000 смогли запустить DeepSeek V4.1-Flash почти на скорости Cerebras
Домашняя AI-система из четырех NVIDIA DGX Spark показала впечатляющую производительность при работе с DeepSeek V4.1-Flash. Компактный кластер с 512 ГБ объединенной памяти выдал почти 500 токенов в секунду.
6 октября в 13:53
6662
2
Форум
Nvidia-backed Reflection AI представила модель Beam
Nvidia-backed Reflection AI представила модель Beam
Американская компания Reflection AI, получившая поддержку Nvidia, представила свою первую открытую по весам модель искусственного интеллекта Beam. Стартап позиционирует её как американский ответ быстро развивающимся китайским моделям вроде DeepSeek, GLM и Qwen.
6 октября в 13:50
378
1
Форум