Análise regional da inflação com dados do IBGE usando Python

Os dados desagregados do IPCA fornecem informações detalhadas sobre o comportamento de preços no Brasil a nível de região metropolitana e município, possibilitando ricas análises regionais de dados. Neste artigo mostramos como acessar, processar e analisar estes dados utilizando o Python.

Aprenda a coletar, processar e analisar dados na formação de Do Zero à Análise de Dados Econômicos e Financeiros com Python.

Passo 01: buscando dados no portal Sidra/IBGE

  1. Acesse o site https://sidra.ibge.gov.br/
  2. Clique em “IPCA
  3. Clique no ícone ao lado do mês/ano chamado “Relação de tabelas da pesquisa
  4. Clique em uma tabela que possua dados regionais (ex: “7060”)
  5. Aplique filtros na página da tabela para obter dados de interesse (ex: tipo de indicador, variação, grupo, subitem, período e nível territorial)
  6. Clique no botão com símbolo de link no canto inferior direito da tela chamado “Links para compartilhar
  7. Copie o link informado no campo “Parâmetros para a API” (ex: https://apisidra.ibge.gov.br/values/t/7060/n7/all/v/2265/p/all/c315/7169/d/v2265%202)

Passo 02: coleta, tratamento e análise de dados

Para obter o código e o tutorial deste exercício faça parte do Clube AM e receba toda semana os códigos em R/Python, vídeos, tutoriais e suporte completo para dúvidas.

  1. Abrir o Python (ex: acesse o Google Colab pelo endereço https://www.colab.new/)
  2. Importe as bibliotecas pandas e plotnine
  3. Colete os dados usando o link copiado na página do Sidra (adicione o termo “?formato=json” no final do link)
  4. Aplique os tratamentos necessários utilizando a biblioteca pandas
    data rm gr valor
    12 2020-12-01 Belém - PA Norte 4.63
    13 2021-01-01 Belém - PA Norte 4.18
    14 2021-02-01 Belém - PA Norte 5.42
    15 2021-03-01 Belém - PA Norte 6.44
    16 2021-04-01 Belém - PA Norte 7.32
  5. Produza sua análise de dados visualmente utilizando a biblioteca plotnine

Conclusão

Os dados desagregados do IPCA fornecem informações detalhadas sobre o comportamento de preços no Brasil a nível de região metropolitana e município, possibilitando ricas análises regionais de dados. Neste artigo mostramos como acessar, processar e analisar estes dados utilizando o Python.

Quer aprender mais?

Clique aqui para fazer seu cadastro no Boletim AM e baixar o código que produziu este exercício, além de receber novos exercícios com exemplos reais de análise de dados envolvendo as áreas de Data Science, Econometria, Machine Learning, Macroeconomia Aplicada, Finanças Quantitativas e Políticas Públicas diretamente em seu e-mail.

Compartilhe esse artigo

Facebook
Twitter
LinkedIn
WhatsApp
Telegram
Email
Print

Comente o que achou desse artigo

Outros artigos relacionados

Análise exploratória para modelagem preditiva no Python

Antes de desenvolver bons modelos preditivos é necessário organizar e conhecer muito bem os dados. Neste artigo, damos algumas dicas de recursos, como gráficos, análises e estatísticas, que podem ser usados para melhorar o entendimento sobre os dados usando Python.

Como usar modelos do Sklearn para previsão? Uma introdução ao Skforecast

Prever séries temporais é uma tarefa frequente em diversas áreas, porém exige conhecimento e ferramentas específicas. Os modelos de machine learning do Sklearn são populadores, porém são difíceis de aplicar em estruturas temporais de dados. Neste sentido, introduzimos a biblioteca Skforecast, que integra os modelos do Sklearn e a previsão de séries temporais de forma simples.

Boletim AM

Receba diretamente em seu e-mail gratuitamente nossas promoções especiais e conteúdos exclusivos sobre Análise de Dados!

Boletim AM

Receba diretamente em seu e-mail gratuitamente nossas promoções especiais e conteúdos exclusivos sobre Análise de Dados!

como podemos ajudar?

Preencha os seus dados abaixo e fale conosco no WhatsApp

Boletim AM

Preencha o formulário abaixo para receber nossos boletins semanais diretamente em seu e-mail.