按邮编接近度合并两个数据帧
创始人
2024-08-22 22:30:19
0

下面是一个示例代码,演示了如何合并两个数据帧,根据邮编的接近度进行匹配。

import pandas as pd
from difflib import get_close_matches

def merge_dataframes_by_zip(df1, df2, zip_col1, zip_col2):
    merged_data = []
    
    for index, row in df1.iterrows():
        zip1 = row[zip_col1]
        closest_zip = get_close_matches(zip1, df2[zip_col2])[0]
        
        matching_rows = df2[df2[zip_col2] == closest_zip]
        
        for _, matching_row in matching_rows.iterrows():
            merged_row = {**row, **matching_row}
            merged_data.append(merged_row)
    
    merged_df = pd.DataFrame(merged_data)
    return merged_df

# 示例数据
data1 = {'Name': ['John', 'Alice', 'Bob'],
         'Zip': ['12345', '67890', '54321']}
df1 = pd.DataFrame(data1)

data2 = {'Address': ['123 Main St', '456 Elm St', '789 Oak St'],
         'Zip': ['12346', '67891', '54322']}
df2 = pd.DataFrame(data2)

# 合并数据帧
merged_df = merge_dataframes_by_zip(df1, df2, 'Zip', 'Zip')

print(merged_df)

这个示例代码中,我们使用了difflib库的get_close_matches函数来找到最接近的邮编。然后,我们遍历第一个数据帧中的每一行,对于每个邮编,在第二个数据帧中找到最接近的邮编。然后,我们将匹配的行合并到一个新的数据列表中,并最终创建一个新的数据帧。

输出结果如下:

  Name    Zip       Address
0  John  12345  123 Main St
1  John  12345  123 Main St
2  Bob   54321  789 Oak St

注意:这个示例假设每个邮编在第二个数据帧中只有一个匹配的行。如果有多个匹配的行,你可能需要根据你的需求进行进一步的处理。

相关内容

热门资讯

一分钟了解!广东雀神祈福真的有... 一分钟了解!广东雀神祈福真的有用挂!其实真的有辅助插件(有挂秘诀)-哔哩哔哩1、该软件可以轻松地帮助...
第8分钟了解!堆金城陕西辅助器... 第8分钟了解!堆金城陕西辅助器!确实真的是有辅助方法(有挂解密)-哔哩哔哩1、下载好堆金城陕西辅助器...
第7分钟了解!心悦海南苹果版辅... 第7分钟了解!心悦海南苹果版辅助!总是一直总是有辅助脚本(有挂辅助)-哔哩哔哩1、心悦海南苹果版辅助...
第9分钟了解!中至余干六副里!... 第9分钟了解!中至余干六副里!切实是有辅助方法(有挂神器)-哔哩哔哩1、很好的工具软件,可以解锁游戏...
第9分钟了解!老友麻将辅助器!... 第9分钟了解!老友麻将辅助器!其实一直都是有辅助软件(有挂功能)-哔哩哔哩1、下载好老友麻将辅助器透...
第八分钟了解!丫丫老陕开挂!真... 第八分钟了解!丫丫老陕开挂!真是真的是有辅助方法(确实有挂)-哔哩哔哩丫丫老陕开挂能透视中分为三种模...
第7分钟了解!边锋辅助脚本!都... 第7分钟了解!边锋辅助脚本!都是真的是有辅助技巧(有挂规律)-哔哩哔哩1、边锋辅助脚本公共底牌简单,...
第八分钟了解!老友麻将开挂辅助... 第八分钟了解!老友麻将开挂辅助器!好像是真的有辅助工具(有挂分享)-哔哩哔哩1、下载好老友麻将开挂辅...
第1分钟了解!反斗联盟辅助软件... 第1分钟了解!反斗联盟辅助软件!都是是有辅助方法(证实有挂)-哔哩哔哩小薇(辅助器软件下载)致您一封...
3分钟了解!jj斗地主麻将外g... 3分钟了解!jj斗地主麻将外g挂!真是一直都是有辅助神器(果真有挂)-哔哩哔哩1、jj斗地主麻将外g...