Implementation of Indexing Techniques to Prevent Data Leakage and Duplication in Internet

Research in this area aims to create a new and efficient method for detecting near-duplicates in online content. Web pages that a search engine has scoured are first parsed to remove HTML elements and java scripts. After this phase, remove common keywords or stop words from the crawled pages. The af...

Celý popis

Uložené v:
Podrobná bibliografia
Vydané v:2022 International Conference on Advances in Computing, Communication and Applied Informatics (ACCAI) s. 1 - 9
Hlavní autori: Nalini, M. K., K, Dhinakaran, D, Elantamilan, Gnanavel, R., Vinod, D.
Médium: Konferenčný príspevok..
Jazyk:English
Vydavateľské údaje: IEEE 28.01.2022
Predmet:
On-line prístup:Získať plný text
Tagy: Pridať tag
Žiadne tagy, Buďte prvý, kto otaguje tento záznam!
Buďte prvý, kto okomentuje tento záznam!
Najprv sa musíte prihlásiť.