Використання великих мовних моделей для адаптивного збору інформації з веб-сторінок

Ескіз

Дата

2026

Назва журналу

Номер ISSN

Назва тому

Видавець

КПІ ім. Ігоря Сікорського

Анотація

Дипломна робота за темою «Використання великих мовних моделей для адаптивного збору інформації з веб-сторінок» виконана студентом кафедри інженерії програмного забезпечення в енергетиці НН ІАТЕ Сусаєвим Богданом Вадимовичем зі спеціальності 121 «Інженерія програмного забезпечення» за освітньо-професійною програмою «Інженерія програмного забезпечення інтелектуальних кібер-фізичних систем в енергетиці». Робота складається зі: вступу; 5 розділів («Постановка задачі», «Аналіз подібних існуючих систем», «Засоби розробки системи», «Опис програмної реалізації», «Робота користувача з програмним продуктом»), висновків до кожного з цих розділів; загальних висновків; списку використаних джерел, який налічує 28 джерел; 14 ілюстрацій; 1 таблиця та 2 додатків. Загальний обсяг роботи 65 сторінок. Актуальність теми: зростання обсягів публікацій ускладнює ручний пошук, а класичні інструменти не розуміють змісту. Великі мовні моделі здатні гнучко автоматизувати збір даних незалежно від верстки. Мета роботи і завдання дослідження: розробка системи збору веб-даних за допомогою великих мовних моделей. Завдання: проєктування архітектури, інтеграція наукових API, дедублікація, оцінка релевантності, порівняльне тестування. Практичне значення одержаних результатів: готовий веб-застосунок, що автоматизує пошук наукової літератури та структуроване вилучення даних з веб-сторінок.

Опис

Ключові слова

велика мовна модель, веб-скрапінг, адаптивне вилучення даних, структуровані дані, науковий пошук, дедублікація, оцінка релевантності, deepseek, fastapi, порівняння методів

Бібліографічний опис

Сусаєв, Б. В. Використання великих мовних моделей для адаптивного збору інформації з веб-сторінок : дипломна робота ... бакалавра : 121 Інженерія програмного забезпечення / Сусаєв Богдан Вадимович. – Київ, 2026. – 66 с.

ORCID

DOI