根据指定列中的字符串值条目是否包含子字符串来分隔熊猫数据框

147

深度：

假设我有以下数据框：

df = pd.DataFrame({'name':['a', 'b', 'c','d','e'], 'description':['vim2tests','vim2trial','vim3tests','vim3zip', 'vim4trial'], 'count':[4,5,6,7,8]})

我试图将其分成3个数据帧，其中包含“ description”条目包含“ vim2”，“ vim3”，“ vim4”子字符串的行。

有有效的方法吗？我可以实现一个for循环来查找所需行的索引，但这根本没有效率，而且我正在努力寻找如何做一个更好的方法。

Datanovice：

IIUC，只需创建一个条件列即可groupby使用str.extract

我们可以将数据框保存在字典中。

dfs = {group : data.drop('key',1) for group,data in 
                 df.assign(key=df['description'].str.extract('(vim\d+)'))\
                           .groupby('key')
}

print(dfs['vim3'])
  name description  count
2    c   vim3tests      6
3    d     vim3zip      7

print(dfs.keys())

dict_keys(['vim2', 'vim3', 'vim4'])

或anky的简单得多的解决方案-

dfs = dict(tuple(
           df.groupby(df['description'].str.extract('(vim\d+)'
                                        ,expand=False))
         ))

要么：

dict(iter(df.groupby(df['description'].str.extract('(vim\d+)',expand=False)))

print(dfs)

{'vim2':   name description  count
 0    a   vim2tests      4
 1    b   vim2trial      5,
 'vim3':   name description  count
 2    c   vim3tests      6
 3    d     vim3zip      7,
 'vim4':   name description  count
 4    e   vim4trial      8}

本文收集自互联网，转载请注明来源。

如有侵权，请联系 [email protected] 删除。

编辑于 2020-06-23

我来说两句

0 条评论

登录后参与评论

根据数据框中的子字符串对列求和

根据指定列中的字符串值条目是否包含子字符串来分隔熊猫数据框

根据指定列中的字符串值条目是否包含子字符串来分隔熊猫数据框

Linux的官方Adobe Flash存储库是否已过时？

如何使用HttpClient的在使用SSL证书，无论多么“糟糕”是

错误：“ javac”未被识别为内部或外部命令，

Modbus Python施耐德PM5300

为什么Object.hashCode（）不遵循Java代码约定

如何正确比较 scala.xml 节点？

在 Python 2.7 中。如何从文件中读取特定文本并分配给变量

在令牌内联程序集错误之前预期为 ')'

数据表中有多个子行，asp.net核心中来自sql server的数据

VBA 自动化错误：-2147221080 (800401a8)

错误TS2365：运算符'！=='无法应用于类型'“（”'和'“）”'

如何在JavaScript中获取数组的第n个元素？

检查嵌套列表中的长度是否相同

如何将sklearn.naive_bayes与（多个）分类功能一起使用？

ValueError：尝试同时迭代两个列表时，解包的值太多（预期为 2）

ES5的代理替代

在同一Pushwoosh应用程序上Pushwoosh多个捆绑ID

如何监视应用程序而不是单个进程的CPU使用率？

如何检查字符串输入的格式

解决类Koin的实例时出错

如何自动选择正确的键盘布局？-仅具有一个键盘布局