Dicas de R: alguns truques para melhorar seus gráficos

No Dicas de R de hoje, vamos apresentar algumas funções que podem melhorar a qualidade dos seus gráficos em ggplot, utilizando para nossas visualizações usando o clássico mtcars. Um gráfico comumente utilizado para a exploração de uma base é o seu histograma, como a seguir:


library(ggplot2)
library(tidyverse)

dados <- mtcars

dados %>% ggplot(aes(x=factor(cyl), y = mpg))+
geom_boxplot()+
labs(y='Milhas por Galão', x = 'Número de cilindros')+
theme_bw()

Porém, podemos utilizar uma alternativa que facilita a visualização da distribuição estimada dos valores, chamada de Kernel Density Estimation. Ela é parente do histograma, e permite uma visualização mais suavizada dos dados. Ademais, com o pacote ggridges, podemos fazer uma visualização semelhante à acima, exibindo os quartis estimados:


library(ggridges)

dados %>% ggplot(aes(x=mpg, y = factor(cyl),
fill = factor(stat(quantile))))+
labs(x='Milhas por Galão', y = 'Número de cilindros')+
scale_x_continuous(breaks = seq(10, 35, by = 5))+
stat_density_ridges(geom = "density_ridges_gradient",
quantile_lines = TRUE, alpha = 1,
rel_min_height = 0.01,
scale = 0.9,
size = 1)+
scale_fill_viridis_d(name = "Quartis")+
theme_minimal()

Agora, vamos adicionar à análise o peso dos carros. Para isso, o modo mais simples de visualizarmos os dados é o gráfico de dispersão:


dados %>% ggplot(aes(x=mpg, y=wt, color=factor(cyl), shape = factor(cyl)))+
geom_point(size = 3) +
labs(x='Milhas por Galão', y = 'Peso', color='Cilindros', shape='Cilindros')

A visualização é facilitada pela inclusão de tanto cores como formatos para cada tipo de variável, permitindo distinguir os pontos que estabelecem a relação descrita. Como podemos ver, a correlação negativa entre as variáveis é fortemente ditada pelos grupos que se definem pelo número de cilindros. Podemos facilitar a visualização da posição dos grupos adicionando elipses em torno de cada um:


dados %>% ggplot(aes(x=mpg, y=wt, color=factor(cyl), shape = factor(cyl)))+
geom_point(size = 3) +
labs(x='Milhas por Galão', y = 'Peso', color='Cilindros', shape='Cilindros')+
stat_ellipse(size=1.05)

 


Compartilhe esse artigo

Facebook
Twitter
LinkedIn
WhatsApp
Telegram
Email
Print

Comente o que achou desse artigo

Outros artigos relacionados

Análise de impacto fiscal sobre o dolár com Python

Usamos uma cesta de 12 moedas para construir um cenário contrafactual da taxa de câmbio após o último anúncio de pacote fiscal, com base em modelagem Bayesiana. No período, o dolár depreciou quase 5% e passou os R$ 6,15, enquanto que na ausência da intervenção a moeda deveria estar cotada em R$ 5,78.

Resultado IBC-br - Outubro/2024

A Análise Macro apresenta os resultados da IBC-br de Outubro de 2024, com gráficos elaborados em Python para coleta, tratamento e visualização de dados. Todo o conteúdo, disponível exclusivamente no Clube AM, foi desenvolvido com base nos métodos ensinados nos cursos da Análise Macro, permitindo aos assinantes acesso aos códigos e replicação das análises.

Resultado PMC - Outubro/2024

A Análise Macro apresenta os resultados da PMC de Outubro de 2024, com gráficos elaborados em Python para coleta, tratamento e visualização de dados. Todo o conteúdo, disponível exclusivamente no Clube AM, foi desenvolvido com base nos métodos ensinados nos cursos da Análise Macro, permitindo aos assinantes acesso aos códigos e replicação das análises.

Boletim AM

Receba diretamente em seu e-mail gratuitamente nossas promoções especiais e conteúdos exclusivos sobre Análise de Dados!

Boletim AM

Receba diretamente em seu e-mail gratuitamente nossas promoções especiais e conteúdos exclusivos sobre Análise de Dados!

como podemos ajudar?

Preencha os seus dados abaixo e fale conosco no WhatsApp

Boletim AM

Preencha o formulário abaixo para receber nossos boletins semanais diretamente em seu e-mail.