7赞

获取pandas应用函数中的行索引

作者：大大炮 | 2023-06-11 19:23

如何解决《获取pandas应用函数中的行索引》经验，为你挑选了2个好方法。

我试图访问DataFrame在Pandas中整个应用的函数中的行的索引.我有这样的事情:

df = pandas.DataFrame([[1,2,3],[4,5,6]], columns=['a','b','c'])
>>> df
   a  b  c
0  1  2  3
1  4  5  6

我将定义一个访问具有给定行的元素的函数

def rowFunc(row):
    return row['a'] + row['b'] * row['c']

我可以像这样申请:

df['d'] = df.apply(rowFunc, axis=1)
>>> df
   a  b  c   d
0  1  2  3   7
1  4  5  6  34

真棒!现在如果我想将索引合并到我的函数中呢？DataFrame添加之前的任何给定行的索引d都是Index([u'a', u'b', u'c', u'd'], dtype='object'),但我想要0和1.所以我不能只访问row.index.

我知道我可以在表中创建一个临时列来存储索引,但是我想知道它是否在某个行对象中存在.

1> EdChum - Rei..：

要在这种情况下访问索引,请访问该name属性:

In [182]:

df = pd.DataFrame([[1,2,3],[4,5,6]], columns=['a','b','c'])
def rowFunc(row):
    return row['a'] + row['b'] * row['c']

def rowIndex(row):
    return row.name
df['d'] = df.apply(rowFunc, axis=1)
df['rowIndex'] = df.apply(rowIndex, axis=1)
df
Out[182]:
   a  b  c   d  rowIndex
0  1  2  3   7         0
1  4  5  6  34         1

请注意,如果这是您正在尝试执行的操作,则以下操作会更快:

In [198]:

df['d'] = df['a'] + df['b'] * df['c']
df
Out[198]:
   a  b  c   d
0  1  2  3   7
1  4  5  6  34

In [199]:

%timeit df['a'] + df['b'] * df['c']
%timeit df.apply(rowIndex, axis=1)
10000 loops, best of 3: 163 µs per loop
1000 loops, best of 3: 286 µs per loop

编辑

3年多后看这个问题,你可以做到:

In[15]:
df['d'],df['rowIndex'] = df['a'] + df['b'] * df['c'], df.index
df

Out[15]: 
   a  b  c   d  rowIndex
0  1  2  3   7         0
1  4  5  6  34         1

但是假设它不像这样微不足道,无论你rowFunc真的在做什么,你都应该使用向量化函数,然后将它们用于df索引:

In[16]:
df['newCol'] = df['a'] + df['b'] + df['c'] + df.index
df

Out[16]: 
   a  b  c   d  rowIndex  newCol
0  1  2  3   7         0       6
1  4  5  6  34         1      16

对这里其他人的警告。我认为您从“ row.name”获得的索引是该行的数字索引。如果您有一个自定义索引（例如，每行都有一个字符串UUID），则不能在`apply`中访问它。更加令人困惑的是，对于第n行，df.iloc [n] .name将在apply之外返回第n行的UUID，但在apply approw.name内将返回n。：http://stackoverflow.com/questions/18316211/access-index-in-pandas-series-apply

@Owen在链接的问题中,那是一个`Series`而不是一个df,对于一个你不能像这样访问索引值的系列,你可以为一个df.对于一个你需要转换为DataFrame的系列,请参阅Jeff的答案,你也可以对该系列做`to_frame()`

2> smci..：

apply() 不是您要寻找的机器人。

DataFrame.iterrows（）允许您遍历行并访问其名称：

for name, row in df.iterrows():
    ...

并且，如果有问题，“ itertuples”的性能通常要好得多：https：//stackoverflow.com/questions/24870953/does-iterrows-have-performance-issues

推荐阅读

程序员
如何查看安装的pip包大小？

如何解决《如何查看安装的pip包大小？》经验，为你挑选了2个好方法。 ... [详细]
程序员
通过PowerShell编写和读取XML配置

如何解决《通过PowerShell编写和读取XML配置》经验，为你挑选了1个好方法。 ... [详细]
程序员
ArrayIndexOutOfBoundsException和IndexOutOfBoundsException之间的区别？

如何解决《ArrayIndexOutOfBoundsException和IndexOutOfBoundsException之间的区别？》经验，为你挑选了1个好方法。 ... [详细]
程序员
FactoMineR MCA中"哪个'不符合逻辑"的含义是什么意思？

如何解决《FactoMineRMCA中"哪个'不符合逻辑"的含义是什么意思？》经验，为你挑选了0个好方法。 ... [详细]
程序员
使用form_tag在Rails中上传文件

如何解决《使用form_tag在Rails中上传文件》经验，为你挑选了1个好方法。 ... [详细]
程序员
验证来自iOS transactionReceipt的签名

如何解决《验证来自iOStransactionReceipt的签名》经验，为你挑选了0个好方法。 ... [详细]
程序员
无法启动'./qemu/windows-x86_64/qemu-system-i386.exe':没有此类文件或目录

如何解决《无法启动'./qemu/windows-x86_64/qemu-system-i386.exe':没有此类文件或目录》经验，为你挑选了1个好方法。 ... [详细]
程序员
在python dask中使用分隔符读取csv

如何解决《在pythondask中使用分隔符读取csv》经验，为你挑选了1个好方法。 ... [详细]
程序员
JavaScript显示/隐藏边框/线条

如何解决《JavaScript显示/隐藏边框/线条》经验，为你挑选了0个好方法。 ... [详细]
程序员
C++模板部分特化由指针函数/ const指针函数没有不同？

如何解决《C++模板部分特化由指针函数/const指针函数没有不同？》经验，为你挑选了1个好方法。 ... [详细]
程序员
Docker容器中的Java进程不会在main()的末尾退出

如何解决《Docker容器中的Java进程不会在main()的末尾退出》经验，为你挑选了0个好方法。 ... [详细]
程序员
为什么可以在Go中的多个return语句中重新定义err

如何解决《为什么可以在Go中的多个return语句中重新定义err》经验，为你挑选了1个好方法。 ... [详细]
程序员
使用Wifi将Lua脚本上传到NodeMCU

如何解决《使用Wifi将Lua脚本上传到NodeMCU》经验，为你挑选了1个好方法。 ... [详细]
程序员
是没有价值的选择选项,有效吗？

如何解决《是没有价值的选择选项,有效吗？》经验，为你挑选了1个好方法。 ... [详细]
程序员
在Dynamics Ax中获取文件名

如何解决《在DynamicsAx中获取文件名》经验，为你挑选了1个好方法。 ... [详细]
程序员
在iTunesConnect中禁用了创建新版本

如何解决《在iTunesConnect中禁用了创建新版本》经验，为你挑选了1个好方法。 ... [详细]
程序员
命名空间的多个别名？

如何解决《命名空间的多个别名？》经验，为你挑选了2个好方法。 ... [详细]
程序员
一次安装多个NuGet包

如何解决《一次安装多个NuGet包》经验，为你挑选了1个好方法。 ... [详细]
程序员
wp_title过滤器对<title>标记没有任何影响

如何解决《wp_title过滤器对<title>标记没有任何影响》经验，为你挑选了1个好方法。 ... [详细]
程序员
绘制一些不等式作为平面

如何解决《绘制一些不等式作为平面》经验，为你挑选了0个好方法。 ... [详细]

大大炮

这个屌丝很懒，什么也没留下！

关注作者

Tags | 热门标签

RankList | 热门文章