谷裕@Minute 2022-10-09 21:20 采纳率: 66.7%
浏览 191
已结题

使用pandas模糊匹配两个DataFrame的两列,报错

使用pandas模糊匹配两个DataFrame的两列,报错
import re
import pandas as pd

df1 = pd.read_excel(r'/Users/Minute/Desktop/XX工作/XXXX品牌标签.xlsx')
df2 = pd.read_excel(r'/Users/Minute/Desktop/XX工作/XXXX全量商户V2.xlsx')

# print(df1.head(), df2.head())
'''  
df1  index brand
0      1  皇冠假日
1      2    假日
2      3  智选假日
3      4    洲际
4      5    华邑
----------------------------------------
df2 mid                NAMES
0    1            长沙华雅国际大酒店
1    2  湖南金龙玉凤集团澧县桃花滩宾馆有限公司
2    3         舟山市新锦港宾馆有限公司
3    4                 普瑞酒店
4    5      南京金陵之星大酒店有限责任公司
'''

dict_keys = {row.index: row.brand for row in df1.itertuples()}

# print(type(dict_keys), dict_keys)
'''
class 'dict'> 
{1: '皇冠假日', 2: '假日', 3: '智选假日', 4: '洲际', 
5: '华邑', 6: '喜来登', 7: '万豪', 8: '万怡', 9: '威斯汀', 
10: '万丽', 11: '福朋', 12: 'JW 万豪', 13: '丽思卡尔顿'}
'''


def merge_func(row):
    row['key_ids'] = [keyid
                      for key_word, keyid in dict_keys.items()
                      if re.search(key_word, row['NAMES'], re.IGNORECASE)]
    return row


df_merge = df2.apply(merge_func, axis=1)
'''
TypeError: first argument must be string or compiled pattern
'''

TypeError: first argument must be string or compiled pattern
修改colunm的标签、修改Python文件名后都报此错。但是使用win电脑执行命令就不报错。
可执行def merge_func(row)函数
  • 写回答

2条回答 默认 最新

  • 请叫我问哥 Python领域新星创作者 2022-10-09 21:43
    关注

    看报错应该是正则使用不正确,re.search()的第一个参数应该是正则表达式的字符串,你这里是整数(字典的键)

    本回答被题主选为最佳回答 , 对您是否有帮助呢?
    评论
查看更多回答(1条)

报告相同问题?

问题事件

  • 系统已结题 10月18日
  • 已采纳回答 10月10日
  • 修改了问题 10月9日
  • 创建了问题 10月9日

悬赏问题

  • ¥15 关于#单片机#的问题:以ATMEGA128或相近型号单片机为控制器设计直流电机调速的闭环控制系统(相关搜索:设计报告|软件设计|流程图)
  • ¥15 打开软件提示错误:failed to get wglChoosePixelFormatARB
  • ¥30 电脑误删了手机的照片怎么恢复?
  • ¥15 (标签-python|关键词-char)
  • ¥15 python+selenium,在新增时弹出了一个输入框
  • ¥15 苹果验机结果的api接口哪里有??单次调用1毛钱及以下。
  • ¥20 学生成绩管理系统设计
  • ¥15 来一个cc穿盾脚本开发者
  • ¥15 CST2023安装报错
  • ¥15 使用diffusionbert生成文字 结果是PAD和UNK怎么办