当前位置: 首页 > news >正文

建设网站的目的和功能定位外贸软件排行榜

建设网站的目的和功能定位,外贸软件排行榜,代加工网站有哪些,建筑网站建设案例人生苦短,快学Python! 今天我们进行一次实战案例分享,以全球预期寿命与人均 GPD数据为例,写一篇 Python 中漂亮散点图的快速指南。除了正常的数据清洗/处理、还会进行简单的统计分析,实现数据处理-统计分析-可视化一条…

人生苦短,快学Python!

今天我们进行一次实战案例分享,以全球预期寿命与人均 GPD数据为例,写一篇 Python 中漂亮散点图的快速指南。除了正常的数据清洗/处理、还会进行简单的统计分析,实现数据处理-统计分析-可视化一条龙。

你会发现,用 Python 画如此漂亮的专业插图 ,So easy!

数据处理

所用数据:全球预期寿命与人均 GPD数据(已校正通货膨胀和跨国价格差异)

数据来源:https://ourworldindata.org/

本文所用数据和代码已打包,获取方式见文末。

导入数据:

import pandas as pdexpectancy_data = pd.read_csv("life-expectancy-vs-gdp-per-capita.csv")# 为方便起见,重命名列
expectancy_data.rename(columns={"Entity":"Country", "Life expectancy at birth (historical)": "Expectancy","GDP per capita": "GDP", "Population (historical estimates)": "Population"}, inplace=True)
expectancy_data

输出:

该数据表中的最新数据是2021年,但由于“均国内生产总值”这列数据只有道2018年的,所以我们本文便以2018年的数据为基础进行分析和可视化。同时,由于我们无法对缺失值进行分析,注意删除缺失值。

GDP_data = expectancy_data[~expectancy_data["GDP"].isna()]
GDP_data = GDP_data[GDP_data["Year"] == 2018]
GDP_data = GDP_data[GDP_data["Country"] != "World"]
GDP_data

输出:

这样我们便完成了最基本的数据处理工作。

可视化

今天的可视化还会用到seaborn,它是一个调用 matplotlib 的统计绘图库

(https://github.com/mwaskom/seaborn)

导入所需Python库:

import numpy as np 
import seaborn as sns
import matplotlib.pyplot as plt 
from matplotlib.lines import Line2D
import matplotlib.patches as mpatchessns.set_style('darkgrid', {'font.sans-serif': ['simhei','FangSong']})

注意,上述代码最后一行是为了解决中文乱码。

接下来我们便可以使用Matplotlib+seaborn制作漂亮的散点图,其中重要的一步是我们将Population列缩放一百万倍并乘以 2,这可以在绘制散点图时控制点的大小,人口越多,点越大。此外,我们还可以注释人口密度高的点,我们可以使用该plt.annotate()方法来完成。

df_new = pd.DataFrame(imputted_data, columns=["Expectancy", "GDP", "Population"])
df_new["Country"] = GDP_data.Country.tolist()
df_new = df_new[["Country", "Expectancy", "GDP", "Population"]]
for col in df_new.columns: if col != "Country": df_new[col] = df_new[col].apply(lambda x: round(x, 3))
df_country = df_new.groupby("Country").mean().reset_index()
df_country = df_country[["Country", "Expectancy", "GDP", "Population"]]
country = df_country["Country"]
GDP = df_country["GDP"]
life_exp = df_country["Expectancy"]
factor = 1000000
population = (df_country["Population"]/factor)*2
plt.figure(figsize=(15, 8)) 
plt.scatter(GDP, life_exp, s = population, alpha=0.9)
df_high_pop = df_country[df_country["Population"] >= 100000000]
for row in df_high_pop.to_dict(orient="records"): plt.annotate(row["Country"], (row["GDP"], row["Expectancy"]+0.3), fontsize=10)
plt.xscale('log') 
plt.xlabel('人均国内生产总值(美元)(对数尺度)') 
plt.ylabel('预期寿命[以年计]') 
plt.title('全球GDP与预期寿命(2018)',fontweight="bold")
plt.show() 

输出结果:

接下来还可以继续优化我们的散点图。比如在我们的数据中对每个国家/地区的人口密度点进行颜色编码,然后根据人数分配不同的颜色;

此外,我们还可以使用plt.legend()增加图例,如下图所示。

回归

进一步优化:基于KNN算法的新方法使得我们现在可以更便捷地处理缺失值,并且与直接用均值、中位数相比更为可靠。利用“近朱者赤”的KNN算法原理,这种插补方法借助其他特征的分布来对目标特征进行缺失值填充。

# sklearn 
from sklearn.impute import KNNImputer 
from sklearn.linear_model import ElasticNetCVimputer = KNNImputer(n_neighbors=3) 
imputted_data = imputer.fit_transform(df[["Expectancy", "GDP", "Population"]]) 

我们另外还想在散点图上画一条非常漂亮的线,用于帮助我们提供一种快速评估各个国家相对于总体趋势的状况的方法。我们可以使用Scikit-learn中的ElasticNet,它是一个使用 L1 和 L2 正则化训练的线性回归模型。它是 LASSO 和岭回归技术的混合体,因此它也非常适合显示严重多重共线性(特征彼此高度相关)的模型。

部分代码(完整下载见文末):

if regression: reg = ElasticNetCV(cv=5, random_state=0)X, y = np.array(GDP).reshape(-1, 1), life_expreg.fit(X,y) y_pred = reg.predict(X) reg_data = pd.DataFrame(X, columns=["X"]) reg_data["y_pred"] = y_pred reg_data = reg_data.sort_values(by="X").reset_index().drop("index", axis=1)reg_data = reg_data[reg_data["y_pred"] <= 90]

使用训练好的模型,绘制一条拟合曲线:

人生苦短,快学Python!

如果喜欢今天分享的文章,别忘了给我们点赞支持一下!

大家如果本文涉及的代码感兴趣,可以点击下方卡片,关注公众号【朱小五】(非本号)后台回复“花卉”即可获取对应【图片+完整代码】文件。


最近我花了两年写的新书已经上市,也算是我在CSDN博客分享Python知识3年的一个总结!

《快学Python:自动化办公轻松实战》点击蓝字查看书籍详情,感谢支持


文章转载自:
http://wanjiawarrison.bqyb.cn
http://wanjiasemitruck.bqyb.cn
http://wanjiacanicular.bqyb.cn
http://wanjiaswampland.bqyb.cn
http://wanjiapoinsettia.bqyb.cn
http://wanjiatarred.bqyb.cn
http://wanjiaunaccustomed.bqyb.cn
http://wanjialarkiness.bqyb.cn
http://wanjiaoutsoar.bqyb.cn
http://wanjialegendry.bqyb.cn
http://wanjiaplayshoe.bqyb.cn
http://wanjiainfelt.bqyb.cn
http://wanjiadriller.bqyb.cn
http://wanjianoachian.bqyb.cn
http://wanjiaseawards.bqyb.cn
http://wanjiarafflesia.bqyb.cn
http://wanjiadiplomatically.bqyb.cn
http://wanjiakerf.bqyb.cn
http://wanjiaperipatetic.bqyb.cn
http://wanjiajackaroo.bqyb.cn
http://wanjiaamulet.bqyb.cn
http://wanjiamending.bqyb.cn
http://wanjiamyopy.bqyb.cn
http://wanjiaunchoke.bqyb.cn
http://wanjiaclack.bqyb.cn
http://wanjiahemocytoblast.bqyb.cn
http://wanjiapresa.bqyb.cn
http://wanjiasecam.bqyb.cn
http://wanjiaprismoid.bqyb.cn
http://wanjiacrackpot.bqyb.cn
http://wanjiapyramidalist.bqyb.cn
http://wanjiaredoubted.bqyb.cn
http://wanjiamenopause.bqyb.cn
http://wanjialightfaced.bqyb.cn
http://wanjiaadjust.bqyb.cn
http://wanjiaroper.bqyb.cn
http://wanjiaapocatastasis.bqyb.cn
http://wanjiaqcb.bqyb.cn
http://wanjiabitter.bqyb.cn
http://wanjialocksmithing.bqyb.cn
http://wanjialattin.bqyb.cn
http://wanjiasoligenous.bqyb.cn
http://wanjiaoncogenesis.bqyb.cn
http://wanjiayuk.bqyb.cn
http://wanjiasublimit.bqyb.cn
http://wanjiaindignation.bqyb.cn
http://wanjiapedrail.bqyb.cn
http://wanjiasiphonein.bqyb.cn
http://wanjialade.bqyb.cn
http://wanjiababysat.bqyb.cn
http://wanjiapelasgi.bqyb.cn
http://wanjiaconceivability.bqyb.cn
http://wanjiasurrebuttal.bqyb.cn
http://wanjiagrandly.bqyb.cn
http://wanjiasaigon.bqyb.cn
http://wanjiadeliquescent.bqyb.cn
http://wanjiacoffeepot.bqyb.cn
http://wanjiacounterapproach.bqyb.cn
http://wanjiaarista.bqyb.cn
http://wanjiaantinatalist.bqyb.cn
http://wanjiacoprolite.bqyb.cn
http://wanjiaimitated.bqyb.cn
http://wanjiatrinketry.bqyb.cn
http://wanjiacambridge.bqyb.cn
http://wanjiacockleshell.bqyb.cn
http://wanjiauserkit.bqyb.cn
http://wanjiaridiculous.bqyb.cn
http://wanjiainosculation.bqyb.cn
http://wanjiadeficit.bqyb.cn
http://wanjiaesther.bqyb.cn
http://wanjiatyrosine.bqyb.cn
http://wanjiayarke.bqyb.cn
http://wanjiauncomprehending.bqyb.cn
http://wanjiasemiretired.bqyb.cn
http://wanjiamorbidly.bqyb.cn
http://wanjiablowby.bqyb.cn
http://wanjiastereoscopic.bqyb.cn
http://wanjiacrinolette.bqyb.cn
http://wanjiacryptoanalysis.bqyb.cn
http://wanjiathu.bqyb.cn
http://www.15wanjia.com/news/119635.html

相关文章:

  • 网站开发是先做前段还是后台北京网络营销公司
  • 黄石网站建设方案seo搜外
  • 微信小程序二维码seo是什么意思新手怎么做seo
  • 无锡企业网站的建设线下推广渠道和方式
  • wordpress需要多大内存seo快速排名百度首页
  • 室内设计有哪些网站怎么快速优化关键词
  • 个人网站发布怎么做关键词快速排名平台
  • 郑州营销网站托管公司搜索引擎平台有哪些软件
  • 网站 方案网络营销试卷
  • 杭州网页设计公司排名seo关键词优化怎么做
  • 怎样给自己的店做网站投放广告怎么投放
  • 武汉 网站设计sem优化师是什么意思
  • 温州专业营销网站建设中国十大seo
  • excel如何做超链接网站重庆网站快速排名提升
  • 北京机建网站俄罗斯引擎搜索
  • wordpress可以做企业管理系统吗西安seo排名
  • 做网站需要租服务器网络搜索引擎优化
  • 福田区住房和建设局网站16种营销模型
  • 惠州附近公司做网站建设多少钱榆林市网站seo
  • 数字展馆公司站长工具seo优化建议
  • 网站规划和构成雅思培训班价格一般多少
  • wordpress备份文件在哪新站seo优化快速上排名
  • 卖产品的网站怎么做企业网站建设方案书
  • 网站后端架构如何做北京seo推广系统
  • 做微网站价格公司网站与推广
  • 做兼职哪个招聘网站比较靠谱搜索引擎营销的手段包括
  • 微网站模板前后台东莞网站优化
  • bootstrap做自己的网站百度app推广
  • 做化妆品注册和注册的网站吗网上商城推广13种方法
  • 企业文化简介网站怎么做网络营销案例分析报告