Российский институт искусственного интеллекта AIRI представил на престижной конференции EMNLP 2025 в Китае целый ряд свежих исследований — всего более десяти работ, посвящённых ускорению и упрощению использования больших языковых моделей. Одно из ключевых открытий — новые методы, которые делают языковые модели более устойчивыми к небольшим изменениям в форматировании пользовательских запросов. Учёные провели первое системное сравнение таких методов и предложили усовершенствованный подход. Теперь модель выбирает самый частый ответ из нескольких независимых генераций, что серьёзно повышает надёжность её решений. Другое важное исследование показало, что современные языковые модели способны восстанавливать длинные фрагменты текста не только пошагово, но и блоками. Если дать нейросети специальные эмбеддинги (отдельные числовые представления), она может сразу генерировать сотни точных токенов — это открывает путь к быстрому и экономичному кодированию текстов. Кроме того, команда AIRI представила новый бенчмарк для оценки языковых моделей, обученных на химических данных. Новый инструмент позволяет лучше понять, насколько хорошо модели справляются с комплексными химическими задачами — вроде описания молекул или предсказания реакций.