Российская библиотека DeepPavlov с открытым исходным кодом получит новые инструменты для работы с ИИ. Ученые из МФТИ...
Российская библиотека DeepPavlov с открытым исходным кодом получит новые инструменты для работы с ИИ. Ученые из МФТИ, MWS AI (входит в «МТС Web Services»), института AIRI, университета ИТМО и AI Talent Hub представили инструменты, которые войдут в новую версию DeepPavlov — библиотеки для разработки и тестирования систем обработки естественного языка.
DeepPavlov — разработанная в России открытая библиотека для создания диалоговых систем и чат-ботов. Она включает готовые модели и инструменты для практических задач обработки естественного языка: понимания пользовательских запросов, поиска ответов в текстах, классификации, работы с тональностью и сборки более сложных сценариев общения. Библиотеку можно адаптировать под конкретные бизнес-задачи, используя как предобученные модели, так и собственные данные.
В опубликованной исследователями статье описаны три новых компонента: классификатор токсичности, детектор контекстных галлюцинаций и классификатор evergreen-вопросов — то есть вопросов, ответы на которые не устаревают со временем. Инструменты предназначены для решения задач, которые стали особенно актуальны с распространением больших языковых моделей.
«Описанные в статье инструменты позволят повысить надёжность и достоверность ответов больших языковых моделей, при этом обеспечивая более высокие метрики и существенно повышая скорость работы по сравнению с базовыми решениями», — сказал Максим Савкин, младший научный сотрудник лаборатории нейронных систем и глубокого обучения Института искусственного интеллекта МФТИ, младший научный сотрудник института AIRI.
Частные облака как новая ступень эволюции ИТ-инфраструктуры Главные ИТ-сценарии
Детектор галлюцинаций помогает находить в ответе модели фрагменты, не подтвержденные переданным контекстом, что наиболее важно для сценариев с RAG, где итоговое качество зависит не только от самой модели, но и от всей инфраструктуры вокруг нее. Классификатор evergreen-вопросов определяет, относится ли конкретный вопрос к числу тех, ответы на которые не устаревают со временем, или для него требуется внешний поиск. Это позволяет не подключать RAG там, где он не требуется, снижая задержку и риск ухудшения ответа из-за нерелевантного контекста. Классификатор токсичности служит дополнительным инструментом контроля безопасности.
«С технической точки зрения DeepPavlov 1.1 можно будет встраивать в существующие решения как отдельный микросервис. Фреймворк поддерживает работу с несколькими языками и может подключаться к внешним системам по API. Это упрощает его интеграцию в уже существующие LLM- и RAG-пайплайны», — отметил инженер-исследователь MWS AI Тимур Ионов.
| # | Наименование новости | Тональность | Информативность | Дата публикации |
|---|---|---|---|---|
| 1 | В ИТМО разработали инструмент для улучшения поисковых систем и ИИ-ассистентов | 5 | 7 | 05-05-2026 |
| 2 | Исследователи из T-Bank AI Research разработали метод универсальной интерпретации моделей без потери точности | 5 | 7 | 11-11-2025 |
| 3 | Российские ученые создали открытую базу данных для изучения концентрации внимания | 5 | 7 | 16-07-2026 |
| 4 | Российские ученые создали открытую базу данных для изучения концентрации внимания | 5 | 7 | 16-07-2026 |
| 5 | В МФТИ научили нейросеть управлять движением миллиона роботов | 7 | 8 | 07-07-2026 |
| 6 | «Антиплагиат» стал умнее | 0 | 5 | 09-07-2026 |
| 7 | «Антиплагиат» стал умнее | 0 | 5 | 09-07-2026 |
| 8 | «Антиплагиат» стал умнее | 0 | 5 | 09-07-2026 |
| 9 | Институт AIRI представил фреймворк для автоматизации ИИ-экспериментов | 0 | 7 | 21-11-2025 |
| 10 | Разработка российских ученых на 20% улучшила работу генеративных форм ИИ | 0 | 0 | 15-08-2025 |