Neste curso, baseado no ambiente de programação Python, pretende-se introduzir os conceitos necessários para compreender os módulos da linguagem que permitem fazer Web Scraping para obter o conteúdo de páginas Web, proceder à sua limpeza, extração de dados e o seu armazenamento para que possam depois ser analisados ou distribuídos para os mais diversos fins. Assim, o programa do curso cobre 3 tópicos:

  • Introdução teórica a REST API e exploração do módulo de requests do Python;
  • Introdução teórica a Web Scraping; exploração do módulo de beautifulsoup do Python
  • Introdução teórica às Expressões Regulares; exploração do módulo re do Python
No final do curso, os alunos : 
  • percebem a relevância prática de fazer Scraping em páginas Web como forma de coletar dados publicados nessas páginas para futuras análises; 
  • sabem criar ficheiros de texto anotados a partir de páginas Web recorrendo a funções Python apropriadas para fazer o Scraping;
  •  sabem proceder à sua limpeza para retirar as anotações e recolher apenas os valores relevantes para posterior processamento.

Os cursos do Projeto "UMinho Mais Digital - Competências para o Futuro" integram-se no Plano de Recuperação e Resiliência de Portugal, financiado pela União Europeia NextGenerationEU (Reforço RE-C06-i07 | Impulso Mais Digital - submedida "Reforço das Competências Digitais", lançado pela DGES).  

Escola/Instituto: Escola de Engenharia
Modalidade: b-learning
Idioma: Português


⏱️DURAÇÃO
9
horas de formação
🎓 Créditos
1
ECTS
👥Participantes por Edição
15
vagas disponíveis
📅 Edições
0
curso não cumpriu o número mínimo de inscritos
💰 Bolsa de mérito
0€
atribuídas no total
🏅 Participantes
0
Diplomados não CTEAM