Design and Implementation of an System for Automatic Phishing Platform Saturation

dc.contributor.advisorPartila, Pavol
dc.contributor.authorMushkalov, Nikita
dc.contributor.refereePlucar, Jan
dc.date.accepted2026-06-03
dc.date.accessioned2026-09-02T14:41:30Z
dc.date.available2026-09-02T14:41:30Z
dc.date.issued2026
dc.description.abstractThis thesis presents the design, implementation, and evaluation of an automated system for active defense against phishing attacks using platform saturation. Unlike traditional detection-centric approaches, the proposed system actively degrades the value of data collected by attackers by automatically submitting realistic, synthetically generated information into phishing forms. The system integrates large language models (LLaMA 3.1, GPT-5-mini) for phishing page detection, language identification, registration page recognition, and semantic field classification. A hybrid field recognition layer combines rule-based heuristics with LLM inference. A Playwright-based automation module with an LLM-driven multi-step orchestrator performs autonomous form filling, submission, and email verification via disposable temporary email addresses. The system was evaluated on a public phishing dataset and on purpose-built test registration website. The phishing detection module achieved an F1 score of 0.750 (GPT-5-mini), registration page recognition reached 0.986 F1, while field detection achieved 0.582 accuracy, identifying remaining robustness challenges. The automation module successfully completed full registration cycles including email verification in controlled laboratory conditions. The results demonstrate that LLM-based saturation is technically feasible and offers a complementary active defense strategy worthy of further research.en
dc.description.abstractTato diplomová práce se zabývá návrhem, implementací a vyhodnocením automatizovaného systému pro aktivní obranu proti phishingovým útokům pomocí saturace phishingových platforem. Na rozdíl od tradičních detekčních přístupů navrhovaný systém aktivně snižuje hodnotu dat získaných útočníky tím, že automaticky odesílá realistická, synteticky generovaná data do phishingových formulářů. Systém integruje velké jazykové modely (LLaMA 3.1, GPT-5-mini) pro detekci phishingových stránek, identifikaci jazyka, rozpoznání registračních stránek a sémantickou klasifikaci polí. Hybridní vrstva pro rozpoznávání polí kombinuje heuristiky založené na pravidlech s inferencí velkých jazykových modelů. Automatizační modul založený na Playwright s orchestrátorem řízeným velkým jazykovým modelem provádí autonomní vyplňování formulářů, odesílání a e-mailové ověření prostřednictvím dočasných e-mailových adres. Systém byl vyhodnocen na veřejném phishingovém datovém souboru a na účelově vytvořených testovacích registračních webových stránkách. Modul detekce phishingu dosáhl F1 skóre 0,750 (GPT-5-mini), rozpoznání registrační stránky dosáhlo F1 0,986, zatímco detekce polí dosáhla přesnosti 0,582, což odhaluje zbývající problémy s robustností. Automatizační modul úspěšně dokončil plné registrační cykly včetně e-mailového ověření v kontrolovaných laboratorních podmínkách. Výsledky ukazují, že saturace založená na velkých jazykových modelech je technicky proveditelná a představuje doplňkovou aktivní obrannou strategii hodnou dalšího výzkumu.cs
dc.description.department460 - Katedra informatikycs
dc.description.resultvýborněcs
dc.format.extent4100079 bytes
dc.format.mimetypeapplication/pdf
dc.identifier.otherOSD002
dc.identifier.senderS2724
dc.identifier.thesisMUS0136_FEI_N0612A140004_2026
dc.identifier.urihttp://hdl.handle.net/10084/160846
dc.language.isoen
dc.publisherVysoká škola báňská – Technická univerzita Ostravacs
dc.rights.accessopenAccess
dc.subjectphishingen
dc.subjectplatform saturationen
dc.subjectactive defenseen
dc.subjectlarge language modelsen
dc.subjectsynthetic dataen
dc.subjectweb automationen
dc.subjectcybersecurityen
dc.subjectdeception technologyen
dc.subjectform fillingen
dc.subjectTemp-Mailen
dc.subjectphishingcs
dc.subjectsaturace platforemcs
dc.subjectaktivní obranacs
dc.subjectvelké jazykové modelycs
dc.subjectsyntetická datacs
dc.subjectwebová automatizacecs
dc.subjectkybernetická bezpečnostcs
dc.subjectdeceptivní technologiecs
dc.subjectvyplňování formulářůcs
dc.subjectTemp-Mailcs
dc.thesis.degree-grantorVysoká škola báňská – Technická univerzita Ostrava. Fakulta elektrotechniky a informatikycs
dc.thesis.degree-levelMagisterský studijní programcs
dc.thesis.degree-nameIng.
dc.thesis.degree-programInformační a komunikační bezpečnostcs
dc.titleDesign and Implementation of an System for Automatic Phishing Platform Saturationen
dc.title.alternativeNávrh a implementace systému pro automatickou saturaci phishingových platforemcs
dc.typeDiplomová prácecs
local.files.count6
local.files.size5748244
local.has.filesyes

Files

Original bundle

Now showing 1 - 5 out of 6 results
Loading...
Thumbnail Image
Name:
MUS0136_FEI_N0612A140004_2026.pdf
Size:
3.91 MB
Format:
Adobe Portable Document Format
Description:
Text práce
Loading...
Thumbnail Image
Name:
MUS0136_FEI_N0612A140004_2026_zadani.pdf
Size:
158.8 KB
Format:
Adobe Portable Document Format
Description:
Zadání
Loading...
Thumbnail Image
Name:
MUS0136_FEI_N0612A140004_2026_priloha.7z
Size:
1.01 MB
Format:
Unknown data format
Description:
Příloha
Loading...
Thumbnail Image
Name:
MUS0136_FEI_N0612A140004_2026_posudek_vedouci_Partila_Pavol.pdf
Size:
197.05 KB
Format:
Adobe Portable Document Format
Description:
Posudek vedoucího – Partila, Pavol
Loading...
Thumbnail Image
Name:
MUS0136_FEI_N0612A140004_2026_posudek_oponent_Plucar_Jan.pdf
Size:
161.6 KB
Format:
Adobe Portable Document Format
Description:
Posudek oponenta – Plucar, Jan