網站首頁 編程語言 正文
一、繪制散點圖
實現功能:
python繪制散點圖,展現兩個變量間的關系,當數據包含多組時,使用不同顏色和形狀區分。
實現代碼:
import numpy as np
import pandas as pd
import matplotlib as mpl
import matplotlib.pyplot as plt
import seaborn as sns
import warnings
warnings.filterwarnings(action='once')
plt.style.use('seaborn-whitegrid')
sns.set_style("whitegrid")
print(mpl.__version__)
print(sns.__version__)
def draw_scatter(file):
? ? # Import dataset
? ? midwest = pd.read_csv(file)
? ? # Prepare Data
? ? # Create as many colors as there are unique midwest['category']
? ? categories = np.unique(midwest['category'])
? ? colors = [plt.cm.Set1(i / float(len(categories) - 1)) for i in range(len(categories))]
? ? # Draw Plot for Each Category
? ? plt.figure(figsize=(10, 6), dpi=100, facecolor='w', edgecolor='k')
? ? for i, category in enumerate(categories):
? ? ? ? plt.scatter('area', 'poptotal', data=midwest.loc[midwest.category == category, :],s=20,c=colors[i],label=str(category))
? ? # Decorations
? ? plt.gca().set(xlim=(0.0, 0.1), ylim=(0, 90000),)
? ? plt.xticks(fontsize=10)
? ? plt.yticks(fontsize=10)
? ? plt.xlabel('Area', fontdict={'fontsize': 10})
? ? plt.ylabel('Population', fontdict={'fontsize': 10})
? ? plt.title("Scatterplot of Midwest Area vs Population", fontsize=12)
? ? plt.legend(fontsize=10)
? ? plt.show()
draw_scatter("F:\數據雜壇\datasets\midwest_filter.csv")
實現效果:
二、繪制邊界氣泡圖
實現功能:
氣泡圖是散點圖中的一種類型,可以展現三個數值變量之間的關系,之前的文章介紹過一般的散點圖都是反映兩個數值型變量的關系,所以如果還想通過散點圖添加第三個數值型變量的信息,一般可以使用氣泡圖。氣泡圖的實質就是通過第三個數值型變量控制每個散點的大小,點越大,代表的第三維數值越高,反之亦然。而邊界氣泡圖則是在氣泡圖添加第四個類別型變量的信息,將一些重要的點選出來并連接。
實現代碼:
import numpy as np
import pandas as pd
import matplotlib as mpl
import matplotlib.pyplot as plt
import seaborn as sns
import warnings
from scipy.spatial import ConvexHull
warnings.filterwarnings(action='once')
plt.style.use('seaborn-whitegrid')
sns.set_style("whitegrid")
print(mpl.__version__)
print(sns.__version__)
def draw_scatter(file):
? ? # Step 1: Prepare Data
? ? midwest = pd.read_csv(file)
? ? # As many colors as there are unique midwest['category']
? ? categories = np.unique(midwest['category'])
? ? colors = [plt.cm.Set1(i / float(len(categories) - 1)) for i in range(len(categories))]
? ? # Step 2: Draw Scatterplot with unique color for each category
? ? fig = plt.figure(figsize=(10, 6), dpi=80, facecolor='w', edgecolor='k')
? ? for i, category in enumerate(categories):
? ? ? ? plt.scatter('area','poptotal',data=midwest.loc[midwest.category == category, :],s='dot_size',c=colors[i],label=str(category),edgecolors='black',linewidths=.5)
? ? # Step 3: Encircling
? ? # https://stackoverflow.com/questions/44575681/how-do-i-encircle-different-data-sets-in-scatter-plot
? ? def encircle(x, y, ax=None, **kw): ?# 定義encircle函數,圈出重點關注的點
? ? ? ? if not ax: ax = plt.gca()
? ? ? ? p = np.c_[x, y]
? ? ? ? hull = ConvexHull(p)
? ? ? ? poly = plt.Polygon(p[hull.vertices, :], **kw)
? ? ? ? ax.add_patch(poly)
? ? # Select data to be encircled
? ? midwest_encircle_data1 = midwest.loc[midwest.state == 'IN', :]
? ? encircle(midwest_encircle_data1.area,midwest_encircle_data1.poptotal,ec="pink",fc="#74C476",alpha=0.3)
? ? encircle(midwest_encircle_data1.area,midwest_encircle_data1.poptotal,ec="g",fc="none",linewidth=1.5)
? ? midwest_encircle_data6 = midwest.loc[midwest.state == 'WI', :]
? ? encircle(midwest_encircle_data6.area,midwest_encircle_data6.poptotal,ec="pink",fc="black",alpha=0.3)
? ? encircle(midwest_encircle_data6.area,midwest_encircle_data6.poptotal,ec="black",fc="none",linewidth=1.5,linestyle='--')
? ? # Step 4: Decorations
? ? plt.gca().set(xlim=(0.0, 0.1),ylim=(0, 90000),)
? ? plt.xticks(fontsize=12)
? ? plt.yticks(fontsize=12)
? ? plt.xlabel('Area', fontdict={'fontsize': 14})
? ? plt.ylabel('Population', fontdict={'fontsize': 14})
? ? plt.title("Bubble Plot with Encircling", fontsize=14)
? ? plt.legend(fontsize=10)
? ? plt.show()
draw_scatter("F:\數據雜壇\datasets\midwest_filter.csv")
實現效果:
原文鏈接:https://blog.csdn.net/sinat_41858359/article/details/125311285
相關推薦
- 2022-03-22 C++運算符重載限制介紹_C 語言
- 2023-07-07 Spring整合Junit單元測試
- 2023-01-03 flutter中的布局和響應式app方法示例_Android
- 2022-10-05 WPF實現好看的Loading動畫的示例代碼_C#教程
- 2022-10-08 Qt動態庫調用宿主進程中的對象方法純虛函數使用_C 語言
- 2023-01-26 詳解Python手寫數字識別模型的構建與使用_python
- 2022-08-26 C++宏函數和內聯函數的使用_C 語言
- 2024-03-01 【Typescript】tsconfig 常用配置項(常用or總結)
- 最近更新
-
- window11 系統安裝 yarn
- 超詳細win安裝深度學習環境2025年最新版(
- Linux 中運行的top命令 怎么退出?
- MySQL 中decimal 的用法? 存儲小
- get 、set 、toString 方法的使
- @Resource和 @Autowired注解
- Java基礎操作-- 運算符,流程控制 Flo
- 1. Int 和Integer 的區別,Jav
- spring @retryable不生效的一種
- Spring Security之認證信息的處理
- Spring Security之認證過濾器
- Spring Security概述快速入門
- Spring Security之配置體系
- 【SpringBoot】SpringCache
- Spring Security之基于方法配置權
- redisson分布式鎖中waittime的設
- maven:解決release錯誤:Artif
- restTemplate使用總結
- Spring Security之安全異常處理
- MybatisPlus優雅實現加密?
- Spring ioc容器與Bean的生命周期。
- 【探索SpringCloud】服務發現-Nac
- Spring Security之基于HttpR
- Redis 底層數據結構-簡單動態字符串(SD
- arthas操作spring被代理目標對象命令
- Spring中的單例模式應用詳解
- 聊聊消息隊列,發送消息的4種方式
- bootspring第三方資源配置管理
- GIT同步修改后的遠程分支