Análise multivariada de dados sobre tipologia de produtos numa empresa
Multivariate analysis of data on typology of products in a company
| dc.contributor.advisor | Sousa, Inês | por |
| dc.contributor.advisor | Rodrigues, Luís | por |
| dc.contributor.author | Costa, Nelson Filipe Sá | por |
| dc.date.accessioned | 2023-06-07T13:55:53Z | |
| dc.date.available | 2023-06-07T13:55:53Z | |
| dc.date.issued | 2023-01-11 | |
| dc.date.submitted | 2022-10 | |
| dc.description.abstract | As pequenas, médias e grandes empresas recolhem os seus dados esperando que estes de alguma forma gerem valor comercial. O machine learning tem a capacidade de fornecer informação valiosa a partir dos dados, servindo de principal estratégia de vendas para que a empresa consiga alcançar maior lucro. O objetivo desta dissertação é analisar dados de vendas da empresa Litel, Lda, procurando extrair padrões de vendas relativos a produtos (caixas e sacos) que compartilham similaridades entre si. Para alcançar este objetivo são apresentadas metodologias de aprendizagem não supervisionada que permitem traçar uma segmentação de grupos, nomeadamente Análise de Componentes Principais (PCA), algoritmos de k-Means e clustering hierárquico. O PCA foi usado para identificar variáveis correlacionadas e identificar padrões ocultos nos dados, nomeadamente famílias de produtos com similaridades nas vendas. Foram aplicados os métodos do cotovelo, da silhueta e dos 30 índices para escolha do melhor número de clusters, de modo a identifi car o número ótimo de clusters. Foram ainda aplicados métodos de validação, de modo a identificar o algoritmo de clustering com melhor desempenho. Através das medidas de estabilidade foi avaliada a consistência dos clusters, e através do coeficiente cofenético foi determinada a combinação de métodos que refletiu num melhor agrupamento de dados. Após realizar as validações anteriores foram implemen tados os respetivos algoritmos de clustering. De um modo geral, todos os algoritmos de clustering segmentaram os dados de uma forma bastante satisfatória podendo destacar a ótima performance do algoritmo clustering hierárquico método ”average”. | por |
| dc.description.abstract | Small, medium and large companies collect their data hoping that it will somehow generate commer cial value. Machine learning has the ability to provide valuable information from data, serving as the main sales strategy for the company to achieve greater profit. The objective of this dissertation is to analyze sales data from the company Litel, Lda, seeking to extract sales patterns related to products (boxes and bags) that share similarities with each other. In order to achieve this objective, unsupervised learning methodologies are presented, which allow for a segmentation of groups, namely Principal Component Analysis (PCA), k-Means algorithms and hierarchical clustering. The PCA was used to identify correlated variables and identify hidden patterns in the data, namely product families with similar sales. The elbow, silhouette and 30 indices methods were applied to choose the best number of clusters, in order to identify the optimal number of clusters. Validation methods were also applied in order to identify the clustering algorithm with the best performance. Through the stability measures, the consistency of the clusters was evaluated, and through the cophenetic coefficient, the combination of methods that reflected a better data grouping was determined. After carrying out the previous validations, the respective clustering algorithms were implemented. In general, all clustering algorithms segmented the data in a very satisfactory way, highlighting the excellent performance of the hierarchical clustering algorithm ”average”method. | por |
| dc.identifier.tid | 203266986 | por |
| dc.identifier.uri | https://hdl.handle.net/1822/84928 | |
| dc.language.iso | por | por |
| dc.rights | openAccess | por |
| dc.rights.uri | http://creativecommons.org/licenses/by-nc-nd/4.0/ | por |
| dc.subject | Machine learning | por |
| dc.subject | PCA | por |
| dc.subject | k-Means | por |
| dc.subject | Clustering hierárquico | por |
| dc.subject | Vendas | por |
| dc.subject | Hierarchical clustering | por |
| dc.subject | Sales | por |
| dc.subject.fos | Ciências Naturais | por |
| dc.title | Análise multivariada de dados sobre tipologia de produtos numa empresa | por |
| dc.title.alternative | Multivariate analysis of data on typology of products in a company | por |
| dc.type | masterThesis | eng |
| dspace.entity.type | Publication | en |
| sdum.degree.grade | 18 valores | por |
| sdum.uoei | Escola de Ciências | por |
| thesis.degree.grantor | Universidade do Minho | por |
| thesis.degree.name | Mestrado em Matemática e Computação | por |
Ficheiros
Pacote original
1 - 1 de 1
A carregar...
- Nome:
- Nelson Filipe Sa Costa.pdf
- Tamanho:
- 3.33 MB
- Formato:
- Adobe Portable Document Format
- Descrição: