Научные труды
Собственные публикации и доклады
1. Механизмы распределенной обработки данных для интернет-магазинов: преимущества и вызовы
Авторы: А.Р. Ястребов, О.В. Рычка
Описание: в статье рассматриваются механизмы распределенной обработки данных для интернет-магазинов, анализируются их ключевые преимущества, такие как масштабируемость и отказоустойчивость, а также вызовы, связанные с безопасностью и согласованностью данных.
2. Экономическая эффективность автоматической модерации с помощью искуственного интелекта в e-commerce
Авторы: А.Р. Ястребов, А.В. Боднар
Описание: в статье рассматриваются теоретические и практические аспекты автоматической модерации контента на базе искусственного интеллекта в электронной коммерции, анализируются её экономическая эффективность, преимущества по сравнению с ручными методами, а также связанные с внедрением риски и перспективы.
3. Параллельная обработка транзакций в системах интернет-торговли с использованием современных архитектур баз данных
(В печати)
Авторы: А.Р. Ястребов, О.В. Рычка
Описание: в статье рассматриваются результаты экспериментального исследования производительности четырех систем управления базами данных (PostgreSQL, MySQL, MariaDB, Firebird) при обработке параллельных транзакций в контексте интернет-торговли, анализируется влияние архитектуры СУБД, уровня изоляции транзакций и размера пакета операций на скорость обработки и надёжность данных.
Доклады и публикации научного руководителя
4. Сравнительный анализ методов интеллектуальной обработки данных для повышения качества прогнозных моделей
Авторы: О.В. Рычка
Описание: в статье рассматриваются результаты сравнительного анализа эффективности различных статистических методов поиска аномальных значений в данных, включая предложенный автором метод на основе построения прямоугольной области надёжности, а также представлена его программная реализация, направленная на повышение качества прогнозных моделей.
5. Сравнение производительности различных подходов в задаче классификации
Авторы: А. О. Истягин, О. В. Рычка
Описание: в статье рассматриваются различные подходы к решению задачи классификации типов номеров отелей, включая использование регулярных выражений в СУБД и на языке C#, а также нейронной сети на Python, проводится сравнительный анализ их производительности и делаются выводы о целесообразности применения каждого метода в зависимости от объёма данных и доступных ресурсов.
6. Практическое использование методов поиска и корректировки аномалий для построения точных прогнозов
Авторы: О. В. Рычка
Описание: в статье рассматриваются разработка и практическая оценка автоматизированной системы для поиска и корректировки аномальных измерений в статистических данных, демонстрируется эффективность предложенных автором методов на реальных примерах и подтверждается их способность повышать точность регрессионных моделей и построенных на их основе прогнозов.
Тематические доклады
7. Сетевая технология для быстрой доставки информации с безопасностью веб-серверов в локальных условиях
Авторы: Й. Б. Курамбаев
Описание: в данной статье рассматриваются особенности развития сетевого программирования и их его на развитие систем обнаружения опасностей. Проведен перекрестный и сравнительный анализ влияния выбора направления развития компьютерных технологий. Даны рекомендации по внедрению разработок в программирование.
8. Метрики для динамического масштабирования баз данных в облачных средах
Авторы: А.В. Бойченко, Д.К. Рогожин, Д.Г. Корнеев
Описание: в статье проводится анализ основных методов масштабирования баз данных (репликация, шардинг) и их поддержки на уровне популярных реляционных СУБД и NoSQL решений с различными моделями данных: документо-ориентированной, ключ-значение, поколоночной, графовой. Приводится оценка возможности современных облачных решений и модель для организации динамического масштабирования в облачной инфраструктуре. Выделяются группы базовых метрик, характеризующих параметры функционирования СУБД и технических средств, а также определяются цели и группы интегральных метрик, необходимых для реализации адаптивных алгоритмов динамического масштабирования баз данных в облачной инфраструктуре.
9. Оптимизация работы информационной системы розничной торговли с помощью nosql
Авторы: Н. П. Орлянская, В. А. Тешев, В. В. Ткаченко
Описание: в статье рассматриваются проектирование и реализация кросс-платформенного веб-приложения на основе нереляционных баз данных MongoDB и Redis для автоматизации бизнес-процессов сети розничных магазинов и интернет-магазина, что обеспечивает гибкость, масштабируемость и повышение производительности системы.
10. Оптимизация высоконагруженных веб-проектов с использованием микросервисной архитектуры
Авторы: М. И. Шумилов
Описание: в данной статье подробно исследуются методы оптимизации высоконагруженных веб-проектов с применением микросервисной архитектуры. Основная цель работы заключается в проведении всестороннего анализа эффективности использования микросервисного подхода для обеспечения гибкости, масштабируемости и высокой отказоустойчивости современных веб-приложений.
11. Озёра данных
Авторы: И. А. Казакова
Описание: в статье рассмотрено применение озёр данных – хранилищ неструктурированных данных, получаемых из различных источников. Рассмотрены возможность совместного использования хранилищ и озёр данных, которая позволяет повысить эффективность использования «сырых», необработанных данных; программное обеспечение для работы с озёрами данных.
12. Повышение производительности баз данных
Авторы: И.Н. Набродова, Г.А. Кузнецов
Описание: в статье рассматривается изучение и определение ключевых пунктов оптимизации баз данных для повышения их производительности на нагруженных проектах.
13. Обеспечение требований ACID для высоконагруженных СУБД
Авторы: И.П. Костенко, М.В. Ступина
Описание: в статье рассматриваются ключевые принципы ACID, которые являются основой надежных и целостных баз данных. ACID — это аббревиатура, обозначающая Atomicity, Consistency, Isolation и Durability, то есть Атомарность, Согласованность, Изоляция и Устойчивость. Дано подробное описание каждого из этих принципов, проанализировано их влияние на надежность и целостность данных, отмечены ограничения, которые необходимо соблюдать для их обеспечения.
14. Особенности NOSQL бд и их отличия от реляционных бд. концепция nosql, бд apache hbase, области их применения
Авторы: М.Т. Мырадов, Д.Я. Гараджаева
Описание: в статье рассматриваются особенности и отличия NoSQL баз данных от реляционных, концепция NoSQL на примере Apache HBase, а также ключевые области их применения для работы с большими объемами данных, высокой масштабируемостью и доступностью.
15. Выявление с помощью нагрузочного тестирования и устранение узких мест в работе с базами данных
Авторы: О.О. Глушкова
Описание: статья посвящена анализу типичных проблем, возникающих при эксплуатации СУБД: от некорректной индексации и неэффективных запросов до дисбаланса в распределенных системах. Рассматриваются практические методы их решения, включая оптимизацию структуры запросов, выбор подходящих типов индексов, внедрение гибридного кэширования и динамического шардинга. Особое внимание уделяется важности нагрузочного тестирования для выявления скрытых узких мест, а также роли регулярного мониторинга метрик производительности. На примерах показано, как сочетание технических решений и грамотной настройки позволяет снизить задержки, минимизировать ошибки и повысить отказоустойчивость систем.
Переводы статей
16. Создание графовой модели нейронной сети для электронной коммерции
Авторы: Булычева Мария
Автор перевода: Ястребов А.Р.
Описание: в статье рассматривается разработка моделей графовых нейронных сетей (GNN) для электронной коммерции, предназначенных для прогнозирования взаимодействия пользователей с контентом главной страницы. Описанные методы ориентированы на использование сетей для повышения релевантности и персонализации пользовательского опыта.
17. Углубленный анализ современных стратегий кэширования в распределенных системах: шаблоны реализации и влияние на производительность
Авторы: Махак Шах, Акааш Вишал Хазарика
Автор перевода: Ястребов А.Р.
Описание: в данном исследовании рассматриваются теоретические основы, модели реализации и влияние различных методологий кэширования на производительность. Мы анализируем архитектуры кэширования, выделяя их влияние на производительность, масштабируемость и надежность системы. Синтезируя отраслевой опыт с теоретическими подходами, данная статья дает представление о выборе и реализации оптимальных стратегий кэширования. Кроме того, мы предлагаем инновационные метрики оценки эффективности кэширования в распределенных средах и представляем эмпирические данные в поддержку конкретных моделей кэширования для различных вариантов использования.
18. Введение в облачные вычисления и примеры облачных баз данных
Авторы: София Сален, Цзинг Ванг
Автор перевода: Ястребов А.Р.
Описание: в данной статье будут приведены примеры моделей облачных сервисов, а также рассмотрены облачные базы данных, предоставляемые компаниями, работающими в сфере облачных вычислений. Поскольку базы данных, предоставляемые платформами облачных вычислений, существенно различаются, в данной статье будут рассмотрены две облачные базы данных: SimpleDB от Amazon, предоставляемая Amazon Web Services (пример IaaS), и Bigtable от Google, предоставляемая Google App Engine (пример PaaS), с точки зрения их модели данных, преимуществ и ограничений.
19. Оптимизация производительности базы данных за счет эффективного управления соединениями
Авторы: Ришаб Гупта
Автор перевода: Ястребов А.Р.
Описание: в статье рассматриваются методы оптимизации производительности баз данных путем внедрения специализированных пулов соединений (Mongobetween для MongoDB и PgBouncer для PostgreSQL), что позволяет снизить нагрузку на ресурсы, уменьшить задержку, повысить пропускную способность и обеспечить стабильность при высоких нагрузках без изменения логики приложения.
20. Шардинг с помощью хэш-партиционирования
Авторы: Кайо Х. Коста, Жоау Вианни Б.М. Фильо, Пауло Энрике М. Майя
Автор перевода: Ястребов А.Р.
Описание: в статье рассматриваются техника горизонтального масштабирования баз данных с помощью хэш-партиционирования как шаблон для равномерного распределения данных между узлами кластера с целью избежания "горячих точек" и обеспечения балансировки нагрузки чтения и записи.