Российские ученые нашли способ оптимизировать работу моделей искусственного интеллекта

13:40 26.03.2026

Человек общается с ИИ-помощником, и тот помнит детали разговора месячной давности и не путается в фактах, а компания при этом не тратит состояние на вычислительные ресурсы. Исследователи Центра практического искусственного интеллекта Сбербанка в сотрудничестве с учёными Института AIRI и Сколтеха нашли способ определять тот самый момент, когда нейросеть при экономии памяти начинает терять смысл. Этот метод лёг в основу научной статьи, представленной на международной конференции EACL 2026 в Марокко. Разработчики применили новый метод при обновлении ИИ-помощника ГигаЧат: теперь он запоминает ключевые факты о пользователе и использует их в дальнейшем общении – делая взаимодействие более естественным и персонализированным.

Современные ИИ-модели умеют рассуждать уже почти как человек, но с памятью часто возникают вопросы. Стандартный подход — просто вложить в контекст нейросети всю историю переписки или кипу документов. Это работает до тех пор, пока текстов мало. Как только контекст достигает определённого размера, могут возникать несоответствия ответам желанным. Модель помнит начало и конец, но теряет то, что было в середине. Учёные называют это эффектом Lost in the Middle. К тому же обработка миллионов токенов требует большого объёма видеопамяти.

Эффективным методом обработки больших объёмов данных является сжатие информации с последующим переводом в векторные представления. Данный подход позволяет минимизировать потребление вычислительных ресурсов. Критическим ограничением метода выступает риск необратимого искажения данных при превышении пороговых значений сжатия — феномен, определенный как переполнение токенов (token overflow).

Российские исследователи предложили инструмент для борьбы с этой проблемой. Они создали лёгкий обучаемый классификатор, который работает как детектор качества. Он проверяет сжатые токены ещё до того, как они попадут в большую языковую модель. Если классификатор видит, что смысл нарушен, он не пропускает испорченный контекст дальше. И тогда система может подставить оригинальный несжатый текст или поискать свежие документы. В любом случае, некорректные данные не уйдут в генерацию, пользователь не получит недостоверный ответ, а компания не потратит лишних средств на вычисления.

Для бизнеса, который встраивает ИИ-модели в свои корпоративные поисковики, ассистентов или боты поддержки, это прямая экономия. Учёным исследование даёт строгую методологию: теперь понятно, где проходит граница сжимаемости текста и как отследить момент переполнения токенов. В обществе же это повышает доверие к технологиям и популярность ИИ-помощников. Например, разработчики применили метод при обновлении флагманской модели Сбера GigaChat Ultra – она научилась запоминать факты о пользователе и использовать их для дальнейшей персонализации общения. Это делает взаимодействие более естественным и комфортным.

«Представьте, что нужно пересказать итоги трёхчасового стратегического совещания парой фраз. Ключевые тезисы вы выделите, но высок риск упустить критически важные нюансы или исказить смысл. Так же работает механизм сжатия контекста в языковых моделях, – отметил Николай Тиден, директор Центра практического искусственного интеллекта Сбербанка. – Наше решение выполняет функцию защитного механизма: мы научились автоматически детектировать порог, за которым краткость перестаёт быть оптимизацией и ведёт к ошибкам, вызывая потерю устойчивости модели. Для бизнеса это означает принципиально новый уровень надёжности искусственного интеллекта — сокращение издержек и повышение точности принятия решений».

комментарии(0)

Вы можете оставить комментарии.

Комментарии отключены - материал старше 3 дней

Новости

23:10 23.04.2026

Мужчина совершил нападение на врачей в больнице в Махачкале

334

21:45 23.04.2026

Сожжение флага Турции в центре Еревана Пашинян считает безответственным и недопустимым

459

20:15 23.04.2026

Премьер Бельгии: Экономические последствия войны США с Ираном очень велики, особенно для нас

554

19:30 23.04.2026

Европа с 2027 вводит запрет на использование СПГ-терминалов российскими компаниями

497

19:16 23.04.2026

Целевой набор в вузы соотнесут с кадровой потребностью

523

18:45 23.04.2026

Еврокомиссар по обороне обещает Киеву «больше дронов, боеприпасов и ракет»

586

18:25 23.04.2026

Песков прокомментировал информацию о военных учениях Польши и Франции

657

17:40 23.04.2026

Общее число танкеров в черном списке ЕС достигло 632

615

17:12 23.04.2026

Сбои в работе интернета в РФ связаны с предотвращением угроз терроризма — Путин

629

17:00 23.04.2026

Часть угольных компаний в РФ могут поглотить или ликвидировать из-за кризиса - министр энергетики РФ

638

Возврат к списку

Поделиться

Российские ученые нашли способ оптимизировать работу моделей искусственного интеллекта

комментарии(0)

Новости

Поделиться

Поделиться

Поделиться

Поделиться

Поделиться

Поделиться

Поделиться

Поделиться

Поделиться

Поделиться