Система интеллектуального конспектирования Сперанский
Описание проекта
Разработка интеллектуального сервиса для автоматического конспектирования академических аудиолекций с фокусом на точные науки. Сервис анализирует аудиопоток, переводит речь в текст и с помощью мультиагентной LLM-архитектуры структурирует материал. Система автоматически распознает математическую речь, конвертируя её в строгий синтаксис LaTeX, а также самостоятельно ищет в интернете и добавляет справки по терминам, которые лектор упомянул вскользь. Цель проекта — избавить студентов и исследователей от рутинной ручной расшифровки, предоставляя им готовые, красиво сверстанные Markdown-конспекты сложных технических дисциплин.
Проблема
Слушатели технических и математических лекций тратят колоссальное количество времени на перенос прослушанного материала в читаемый текстовый формат. Лекторы часто говорят сбивчиво, ссылаются на теоремы без их объяснения, а ручной набор математических формул (интегралов, матриц, пределов) требует специфических навыков и сильно замедляет процесс создания конспекта. Существующие на рынке системы транскрибации выдают «сырую» простыню неструктурированного текста без формул, которая абсолютно непригодна для изучения точных наук без многочасовой ручной переработки и редактуры.
Решение
Мы предлагаем комплексную мультиагентную ИИ-систему, превращающую сырую аудиозапись сложной лекции в идеальный академический конспект.
- Процессинг и транскрибация: Пользователь загружает аудиофайл через мобильное приложение. Система переводит голос в базовый текст, визуализируя для пользователя прогресс на каждом этапе обработки.
- Изолированная генерация LaTeX: Специализированный ИИ-инструмент (Tool) распознает участки текста с математической речью (например, «икс плюс игрек равно эпсилон») и с высокой точностью конвертирует их в валидный код LaTeX.
- Обогащение контекстом (Web Search Agent): Автономный поисковый агент выявляет сложные термины, упомянутые без пояснений (например, «условие Липшица»), находит достоверную информацию в сети и органично встраивает академические справки-сноски в текст.
- Оркестрация и форматирование: Большая языковая модель выступает в роли главного редактора. Она принимает артефакты от агентов (формулы, справки), сглаживает стилистику «одеяла из разных текстов», разбивает материал на логические блоки и выдает финальный, эстетичный Markdown-документ.
