Nel settore dell'automazione industriale, l'analisi manuale dei log conversazionali per l'estrazione di domande ricorrenti è un'operazione dispendiosa e cognitivamente non scalabile. Questo lavoro di tesi, sviluppato in collaborazione con Danfoss S.r.l., presenta una data pipeline automatizzata progettata per superare tale criticità. L'architettura adotta un approccio ibrido che integra tecniche di Topic Modeling non supervisionato, orchestrate tramite BERTopic con algoritmi di riduzione dimensionale e clustering, e le capacità generative dei Large Language Models (LLM). La pipeline elabora i log testuali, filtra il rumore, raggruppa semanticamente le problematiche affini e delega all'LLM la stesura automatizzata di risoluzioni strutturate. L'output finale è una Knowledge Base dinamica, validabile da operatori umani e concepita per essere direttamente integrata, mediante un tool di Semantic Caching, in sistemi ad agenti autonomi. L'approccio ingegnerizzato abbatte i costi operativi del triage manuale e abilita un ecosistema di supporto tecnico scalabile e capace di apprendimento continuo.

Integrazione in sistemi ad agenti di una pipeline di analisi conversazionale basata su clustering e Large Language Models

DIFINO, ANDREA
2025/2026

Abstract

Nel settore dell'automazione industriale, l'analisi manuale dei log conversazionali per l'estrazione di domande ricorrenti è un'operazione dispendiosa e cognitivamente non scalabile. Questo lavoro di tesi, sviluppato in collaborazione con Danfoss S.r.l., presenta una data pipeline automatizzata progettata per superare tale criticità. L'architettura adotta un approccio ibrido che integra tecniche di Topic Modeling non supervisionato, orchestrate tramite BERTopic con algoritmi di riduzione dimensionale e clustering, e le capacità generative dei Large Language Models (LLM). La pipeline elabora i log testuali, filtra il rumore, raggruppa semanticamente le problematiche affini e delega all'LLM la stesura automatizzata di risoluzioni strutturate. L'output finale è una Knowledge Base dinamica, validabile da operatori umani e concepita per essere direttamente integrata, mediante un tool di Semantic Caching, in sistemi ad agenti autonomi. L'approccio ingegnerizzato abbatte i costi operativi del triage manuale e abilita un ecosistema di supporto tecnico scalabile e capace di apprendimento continuo.
2025
Integration of a Conversation Analysis Pipeline Based on Clustering and Large Language Models into Agent-Based Systems
Clustering
LLM
Agenti
Pipeline
File in questo prodotto:
File Dimensione Formato  
Difino_Andrea.pdf

Accesso riservato

Dimensione 3.44 MB
Formato Adobe PDF
3.44 MB Adobe PDF

The text of this website © Università degli studi di Padova. Full Text are published under a non-exclusive license. Metadata are under a CC0 License

Utilizza questo identificativo per citare o creare un link a questo documento: https://hdl.handle.net/20.500.12608/111044