1 / 11

Расширение представления документов при поиске в Веб

Расширение представления документов при поиске в Веб. Владимир Иванов, Игорь Некрестьянов, Надежда Пантелеева Санкт-Петербургский Государственный Университет http://ir.apmath.spbu.ru. Методы представления документов в ИПС. Цели работы.

lois-boone
Download Presentation

Расширение представления документов при поиске в Веб

An Image/Link below is provided (as is) to download presentation Download Policy: Content on the Website is provided to you AS IS for your information and personal use and may not be sold / licensed / shared on other websites without getting consent from its author. Content is provided to you AS IS for your information and personal use only. Download presentation by click this link. While downloading, if for some reason you are not able to download a presentation, the publisher may have deleted the file from their server. During download, if you can't get a presentation, the file might be deleted by the publisher.

E N D

Presentation Transcript


  1. Расширение представления документов при поиске в Веб Владимир Иванов, Игорь Некрестьянов, Надежда Пантелеева Санкт-Петербургский Государственный Университет http://ir.apmath.spbu.ru

  2. Методы представления документов в ИПС

  3. Цели работы • Помогает ли расширение представления повысить качество поиска? • Какие объективные характеристики обуславливают улучшение?

  4. Методы расширения Веб-документов • Base (одна Веб-страница) • SameDirectory (Веб-страница и ее соседи в рамках директории) • SameServer (Веб-страница и ее соседи в рамках Веб-сервера) • Greedy (Веб-страница и все ее соседи)

  5. Влияние на классификацию Методы: • Tfidf • Probabalistic Indexing (prind) • NaiveBayes (NB) • Support Vector Machine (SVM) Критерий качества классификации: Accuracy = Ncorrect / Nincorrect * 100 %

  6. Наборы данных Dataset50 – набор 50 категорий из каталога List.Ru по 100 документов в каждой категории

  7. Расширение представления повышает качество поиска

  8. Стабильность результата

  9. Изменение объективных характеристик

  10. Обучение и тестирование на разных представлениях

  11. Наблюдения

More Related