在进行特征工程、划分数据集的工作中,drop()函数都能派上用场。它可以轻松剔除数据、操作列和操作行等。

drop()详细的语法如下:

删除行是index,删除列是columns:

DataFrame.drop(labels=None, axis=0, index=None, columns=None, inplace=False)

参数:

labels:要删除的行或列的标签,可以是单个标签,也可以是标签列表。

axis:要删除的行或列的轴,0表示行,1表示列。

index:要删除的行的索引,可以是单个索引,也可以是索引列表。

columns:要删除的列的列名,可以是单个列名,也可以是列名列表。

inplace:是否在原DataFrame上进行操作,默认为False,即不在原DataFrame上进行操作。


删除列

使用场景1:删除不需要的特征。

例如:有些特征对结果的影响不大,就可以把与因变量不相关的自变量删掉;为了避免多重共线性,要把有强相关关系的自变量删掉。

df = data.drop(data[['RowNumber','CustomerId','Surname']],axis=1)
df

代码讲解:

data是数据集,两个中括号代表DataFrame格式,里面筛选了3个要删除的字段;

axis=1代表操作列;

运行结果:


使用场景2:把因变量删掉

# 自变量、因变量
x_data = df.drop(['Exited'],axis=1)
y_data = df['Exited']
x_data

代码讲解:

drop()函数里面填写要删除的字段,表示从df中删除名为“Exited”的列;

['Exited']这一个字段是我们要剔除的因变量,单个字段可以这样表示;

运行结果:


删除行

使用场景3:在划分数据集的时候,生成了训练集,把被分到训练集的样本剔除掉,剩下的就是测试集了。

#划分训练集
train_data = data.sample(frac = 0.8, random_state = 0)
#测试集
test_data = data.drop(train_data.index)

代码讲解:

drop()函数里面填行索引可以删除掉行;

train_data是我们划分好的训练集,train_data.index表示行索引;

axis=0,表示的是删除行,也可以不写,是默认值;

Python机器学习:drop()删除行列相关推荐

  1. python - pandas 之 dataframe - 行列筛选/遍历/新增/删除/连接/合并/修改/跨表update

    目录 1.dataframe行列筛选 2.dataframe遍历行列 3.dataframe新增行列 4.drop删除指定行列 5.dataframe修改行列值 6.merge连接列 7.append ...

  2. python输出与删除某行或某列

    python输出字符,主要为结合变量形成新的变量名 year = 2016 event = 'Referendum' f'Results of the {year} {event}''Results ...

  3. Python机器学习建模的标准流程(特征工程+建模调参+模型评估+全流程可视化)

    作者CSDN:进击的西西弗斯 本文链接:https://blog.csdn.net/qq_42216093/article/details/116994199 版权声明:本文为作者原创文章,转载需征得 ...

  4. python机器学习-建立随机森林预测模型并特征分析(完整代码+实现效果)

    实现功能: python机器学习-建立随机森林预测模型并特征分析. 实现效果: # 导入需要的库 from warnings import simplefilter simplefilter(acti ...

  5. python机器学习案例-支持向量机建模及评估(完整代码+实现效果)

    实现功能: python机器学习案例-支持向量机建模及评估. 实现代码: # 导入需要的库 from warnings import simplefilter simplefilter(action= ...

  6. python机器学习-朴素贝叶斯(Naive Bayes)模型建立及评估(完整代码+实现效果)

    实现功能: python机器学习-朴素贝叶斯(Naive Bayes)模型建立及评估. 实现代码: # 导入需要的库 from warnings import simplefilter simplef ...

  7. 【Mo 人工智能技术博客】采用 Python 机器学习预测足球比赛结果

    采用 Python 机器学习预测足球比赛结果 足球是世界上最火爆的运动之一,世界杯期间也往往是球迷们最亢奋的时刻.比赛狂欢季除了炸出了熬夜看球的铁杆粉丝,也让足球竞猜也成了大家茶余饭后最热衷的话题.甚 ...

  8. Python机器学习笔记:使用Keras进行回归预测

    Keras是一个深度学习库,包含高效的数字库Theano和TensorFlow.是一个高度模块化的神经网络库,支持CPU和GPU. 本文学习的目的是学习如何加载CSV文件并使其可供Keras使用,如何 ...

  9. python模型预测足球_采用 Python 机器学习预测足球比赛结果!买谁赢就谁赢!

    采用 Python 机器学习预测足球比赛结果 足球是世界上最火爆的运动之一,世界杯期间也往往是球迷们最亢奋的时刻.比赛狂欢季除了炸出了熬夜看球的铁杆粉丝,也让足球竞猜也成了大家茶余饭后最热衷的话题.甚 ...

最新文章

  1. 计算机与图像处理论文标题,数字图像处理论文各种题目.doc
  2. 一个用理性设计的搞笑游戏
  3. CodeForces - 670C Cinema(离散化+排序/map,水题)
  4. Could not find qmake configuration file解决
  5. js(Dom+Bom)第三天(2)
  6. 经常需要在开发中使用Excel COM,为简化使用写了这个类,感觉还是不太方便
  7. 30秒解决电脑越用越卡的大众常见难题
  8. Firefox 3中的快捷键!
  9. HDU2022 海选女主角【最值】
  10. 通用 字符串工具类
  11. 如何将Excel转换为vCard
  12. html字体中英文设置,用 CSS3 指定网页的中英文分别使用不同字体
  13. 戴尔 成铭3980台式计算机,戴尔成铭3980台式机电脑适合家用吗?-dell成铭3980改win7,dell3980改win7bios设置...
  14. HDU 1051 Wooden Sticks 造木棍【贪心】
  15. 考研“后悔”行为大赏!据说90%的考研er都逃不过第三条!
  16. MRD 和PRD的区别
  17. 白话23 种设计模式,看完秒懂!
  18. java mapper层_Java 通用Mapper的设计
  19. 赋能景区,连接科技,加推人工智能名片助力旅游业开启数字化服务
  20. 教师干货丨这5款微课必备提效神器,我要告诉全世界!

热门文章

  1. 书论50 宋高宗《翰墨志》
  2. 移动屏幕旋转解决方法
  3. CodeForces - 1312E Array Shrinking(区间dp)(通俗易懂)
  4. html5游戏卡顿掉线,流放之路卡顿怎么解决
  5. Afraidgate: Major Exploit Kit Campaign Swaps Locky Ransomware for CryptXXX
  6. sublime text3 安装插件
  7. 支持M1和Intel:E3D三维模型AE插件 mac版(支持ae2022)
  8. mybatis 分页
  9. 阻止Mac版 Adobe Acrobat Pro DC的顽固的自动更新
  10. Traceroute(路由追踪)的原理及实现