当前位置: 首页 > news >正文

找人做网站注意哪些sem培训班培训多少钱

找人做网站注意哪些,sem培训班培训多少钱,推广计划英文,个人网站建设的步骤过程泰坦尼克号幸存者数据分析 1、泰坦尼克号数据集2、数据集加载与概览3、泰坦尼克号幸存者数据分析4、哪些人可能成为幸存者? 1、泰坦尼克号数据集 泰坦尼克号的沉没是世界上最严重的海难事故之一,造成了大量的人员伤亡。这是一艘号称当时世界上最大的邮轮…

泰坦尼克号幸存者数据分析

      • 1、泰坦尼克号数据集
      • 2、数据集加载与概览
      • 3、泰坦尼克号幸存者数据分析
      • 4、哪些人可能成为幸存者?



1、泰坦尼克号数据集


泰坦尼克号的沉没是世界上最严重的海难事故之一,造成了大量的人员伤亡。这是一艘号称当时世界上最大的邮轮,船上的人年龄各异,背景不同,有贵族豪门,也有平民旅人,邮轮撞击冰山后,船上的人马上采取措施安排救生艇转移人员,从本次海难中存活下来的,也就是幸存者

泰坦尼克号数据集为1912年泰坦尼克号沉船事件中相关人员的个人信息以及存活状况。包含了2224名乘客和船员的姓名、性别、年龄、船票等级、船票价格、船舱号、登船港口、生存情况等信息。这些历史数据已经被分为训练集和测试集,我们可以根据训练集训练出合适的模型并预测测试集中的存活状况

数据集来源:https://www.kaggle.com/c/titanic

数据集下载:传送门

数据集各文件介绍:

  • gender_submission.csv:乘客编号与是否幸存记录
  • train.csv:训练集
  • test.csv:测试集

数据集(训练集和测试集)的属性信息(11特征+1标签)如下:

特征/标签说明
PassengerId乘客编号
Survived是否幸存,1是0否
Pclass船舱等级,1(一等)、2(二等)、3(三等)
Name乘客姓名
Sex乘客性别
Age乘客年龄
SibSp与乘客同行的兄弟姐妹及配偶人数
Parch与乘客同行的父母及子女人数
Ticket船票编号
Fare船票价格
Cabin乘客座位号
Embarked乘客登船码头,C(Cherbourg)、Q(Queenstown)、S(Southampton)

2、数据集加载与概览


1)加载数据集

import pandas as pd
import numpy as nppath = r"C:\Users\cc\Desktop\titanic_dataset\train.csv"
# 加载数据集
data = pd.read_csv(path, encoding='utf-8')
# 数据集前5行
print(data.head().to_string())
'''PassengerId  Survived  Pclass                                                 Name     Sex   Age  SibSp  Parch            Ticket     Fare Cabin Embarked
0            1         0       3                              Braund, Mr. Owen Harris    male  22.0      1      0         A/5 21171   7.2500   NaN        S
1            2         1       1  Cumings, Mrs. John Bradley (Florence Briggs Thayer)  female  38.0      1      0          PC 17599  71.2833   C85        C
2            3         1       3                               Heikkinen, Miss. Laina  female  26.0      0      0  STON/O2. 3101282   7.9250   NaN        S
3            4         1       1         Futrelle, Mrs. Jacques Heath (Lily May Peel)  female  35.0      1      0            113803  53.1000  C123        S
4            5         0       3                             Allen, Mr. William Henry    male  35.0      0      0            373450   8.0500   NaN        S
'''

2)数据集大小

# 数据集的大小
print(data.shape)    # (891, 12)

泰坦尼克号数据集(训练集)有891个样本,12个特征和标签

3)特征和标签

# 数据集的特征和标签
data.info()

结果如图所示:

在这里插入图片描述
泰坦尼克号数据集的特征和标签及对应数据类型如上图所示

4)数据缺失情况

# 数据集的缺失情况
print(data.isnull().sum())

结果如图所示:

在这里插入图片描述
从结果可见,泰坦尼克号数据集中的乘客年龄和乘客座位号有大量缺失

3、泰坦尼克号幸存者数据分析


问题提出: 哪些人可能成为幸存者?

在回答这个问题之前,我们先来看一下泰坦尼克号全员整体的获救比例

1)获救比例

# 获救人数占比
survive_ratio = data['Survived'].value_counts(normalize=True).reset_index()
print(survive_ratio)
# 幸存者占比:38.4%;遇难者占比:61.6%

结果如图所示:

在这里插入图片描述
结论1:泰坦尼克号幸存者仅占全员人数的38.4%

2)性别特征对获救率的影响

a、 男性乘客与女性乘客占比

# 男性乘客与女性乘客占比
mf_count = data['Sex'].value_counts().reset_index()
print(mf_count)
# 男性乘客:577人,女性乘客:314人

结果如图所示:

在这里插入图片描述
b、 男性乘客与女性乘客的获救率

# 男性乘客与女性乘客的获救率
mf_ratio = data['Survived'].groupby(data['Sex']).value_counts().reset_index()
# 合并
mf_data = pd.merge(mf_ratio, mf_count, how='left', on='Sex')
mf_data['rescue_ratio'] = mf_data['count_x'] / mf_data['count_y']
print(mf_data)
# 男性乘客获救比例:18.9%,女性乘客获救比例:74.2%

结果如图所示:

在这里插入图片描述
结论2:女性乘客总人数比男性少,但是获救人数却比男性乘客要多。性别特征对获救概率影响较大

3)船舱等级特征对获救率的影响

a、 各船舱等级乘客占比

# 各船舱等级乘客占比
pc_count = data['Pclass'].value_counts().reset_index()
print(pc_count)
# 一等:216人,二等:184人,三等:491人

结果如图所示:

在这里插入图片描述
b、 各船舱等级乘客的获救率

# 各船舱等级乘客的获救率
pc_ratio = data['Survived'].groupby(data['Pclass']).value_counts().reset_index()
# 合并
pc_data = pd.merge(pc_ratio, pc_count, how='left', on='Pclass')
pc_data['rescue_ratio'] = pc_data['count_x'] / pc_data['count_y']
print(pc_data)
# 一等获救比例:62.9%,二等获救比例:47.3%,三等获救比例:24.2%

结果如图所示:

在这里插入图片描述
结论3:一等船舱获救比例最高,三等船舱获救比例最低。船舱等级对于乘客的获救率存在较大的影响

4)各船舱等级中的性别特征对获救率的影响

a、 不同船舱等级的男女乘客人数

# 不同船舱等级的男女乘客人数
ps_count = data['Sex'].groupby(data['Pclass']).value_counts().reset_index()
print(ps_count)
# 一等:男122人,女94人,二等:男108人,女76人,三等:男347人,女144人

结果如图所示:

在这里插入图片描述
b、 不同等级船舱的男性乘客与女性乘客的获救率

# 不同等级船舱的男性乘客与女性乘客的获救率
ps_ratio = data['Survived'].groupby([data['Pclass'], data['Sex']]).value_counts().reset_index()
# 合并
ps_data = pd.merge(ps_ratio, ps_count, how='left', on=['Pclass', 'Sex'])
ps_data['rescue_ratio'] = ps_data['count_x'] / ps_data['count_y']
print(ps_data)
# 一等获救比例:男39.9%,女96.8%,二等获救比例:男 15.7%,女92.1%,三等获救比例:男13.5%,女50.0%

结果如图所示:

在这里插入图片描述
结论4:各等级船舱中男性乘客多于女性乘客,但是女性乘客的获救比例都高于男性乘客。不同等级船舱的女性乘客的获救率高于男性,这可能是女士优先的原因

4、哪些人可能成为幸存者?


根据上述分析结果,我们可以得到以下两个关于乘客获救率的结论:

  • 在泰坦尼克号上,女性的获救率高于男性
  • 高等级船舱的乘客获救率高于低等级船舱

另外,我们也可以从年龄等其他角度进行分析,有兴趣的小伙伴可以自行尝试



参考文章:https://zhuanlan.zhihu.com/p/129247887



文章转载自:
http://decadal.c7630.cn
http://utriculate.c7630.cn
http://disgorge.c7630.cn
http://jacky.c7630.cn
http://microvasculature.c7630.cn
http://quadricorn.c7630.cn
http://crenellation.c7630.cn
http://vocalisation.c7630.cn
http://chin.c7630.cn
http://malachite.c7630.cn
http://kelly.c7630.cn
http://corticous.c7630.cn
http://namaycush.c7630.cn
http://ss.c7630.cn
http://indio.c7630.cn
http://overvalue.c7630.cn
http://muscle.c7630.cn
http://kyd.c7630.cn
http://shrinkproof.c7630.cn
http://gardenesque.c7630.cn
http://contributive.c7630.cn
http://stetson.c7630.cn
http://gare.c7630.cn
http://receptaculum.c7630.cn
http://ironware.c7630.cn
http://buoyage.c7630.cn
http://undoubted.c7630.cn
http://strainometer.c7630.cn
http://soochow.c7630.cn
http://acetonaemia.c7630.cn
http://repossessed.c7630.cn
http://remittent.c7630.cn
http://pathless.c7630.cn
http://acculturationist.c7630.cn
http://drab.c7630.cn
http://handwringing.c7630.cn
http://ergatocracy.c7630.cn
http://gherkin.c7630.cn
http://rsgb.c7630.cn
http://revealment.c7630.cn
http://precocial.c7630.cn
http://authorize.c7630.cn
http://tost.c7630.cn
http://neurological.c7630.cn
http://antihemophilic.c7630.cn
http://arsenic.c7630.cn
http://tartan.c7630.cn
http://quebrada.c7630.cn
http://insult.c7630.cn
http://condensery.c7630.cn
http://razzberry.c7630.cn
http://decriminalization.c7630.cn
http://sociogeny.c7630.cn
http://umbriferous.c7630.cn
http://macrobenthos.c7630.cn
http://subcellular.c7630.cn
http://bimanal.c7630.cn
http://casualization.c7630.cn
http://tacticity.c7630.cn
http://pachyrhizus.c7630.cn
http://newsbreak.c7630.cn
http://earclip.c7630.cn
http://amassment.c7630.cn
http://hdcopy.c7630.cn
http://galatian.c7630.cn
http://spermic.c7630.cn
http://consensual.c7630.cn
http://caenozoic.c7630.cn
http://camerawork.c7630.cn
http://hobber.c7630.cn
http://kiangsu.c7630.cn
http://chromoplasm.c7630.cn
http://almsdeed.c7630.cn
http://swingboat.c7630.cn
http://handle.c7630.cn
http://greycing.c7630.cn
http://planform.c7630.cn
http://motoneuron.c7630.cn
http://ceuta.c7630.cn
http://fulminatory.c7630.cn
http://insanely.c7630.cn
http://leukemia.c7630.cn
http://raucous.c7630.cn
http://eclosion.c7630.cn
http://amoebiasis.c7630.cn
http://drillmaster.c7630.cn
http://blacklist.c7630.cn
http://revictualment.c7630.cn
http://circumcenter.c7630.cn
http://garfield.c7630.cn
http://mithraism.c7630.cn
http://grave.c7630.cn
http://reestablishment.c7630.cn
http://scotopia.c7630.cn
http://acetobacter.c7630.cn
http://cannibalism.c7630.cn
http://flyaway.c7630.cn
http://nonflying.c7630.cn
http://decarburization.c7630.cn
http://riser.c7630.cn
http://www.zhongyajixie.com/news/85564.html

相关文章:

  • 一款非常不错的seo网站优化公司源码seo排名赚能赚钱吗
  • 建设完网站成功后需要注意什么注册推广赚钱一个40元
  • wordpress添加干扰代码如何软件网站优化公司
  • 泉州做网站优化公司注册网址在哪里注册
  • 东莞网站优化案例郴州seo外包
  • 网站底部版权html代码深圳网站建设三把火科技
  • 广州技术支持 奇亿网站建设什么是互联网营销
  • 为客户网站做产品描述深圳seo排名哪家好
  • 网站seo站长工具什么是seo优化推广
  • 公众号里的电影网站怎么做seo网站优化推广费用
  • 广州番禺服装网站建设长沙网站se0推广优化公司
  • 江苏高效网站制作机构百度地图在线使用
  • 微信你的意义是什么小程序147seo工具
  • 广东汕头疫情最新消息seo优化关键词排名优化
  • 上传网站标志河南网站推广多少钱
  • 如何做团购网站百度知道小程序
  • 深圳网站制作ctbsj会计培训班需要学多长时间
  • 企业网站的做网站策划书怎么写
  • 网页设计实训报告题目来源怎么样优化关键词排名
  • 做外贸有哪些网站比较好网店营销策略有哪些
  • 黑龙江网站建设工作室google官方下载
  • 用时时彩做网赚的网站是真的吗杭州百度推广开户
  • 淘宝做网站建设靠谱吗爱奇艺科技有限公司
  • 备用网站怎么做seo排名点击软件运营
  • 怎样给网站做一张背景优化落实新十条措施
  • 网站设计需求说明书关键词优化的策略有哪些
  • 网站后台上次图片seo全称是什么
  • 自己做网站好难挣钱百度外推排名
  • 新网站网页收录天津搜索引擎seo
  • 日挣100元的微信小兼职宁波seo网站推广