import pandas as pd from difflib import SequenceMatcher # 读取Excel文件 df = pd.read_excel(r'C:\Users\Admin\Desktop\1000.xlsx') # 比较相似度函数 def similarity(a, b): return SequenceMatcher(None, str(a), str(b)).ratio() # 创建同名和不同名的DataFrame same_df = pd.DataFrame(columns=df.columns) unsame_df = pd.DataFrame(columns=df.columns) # 遍历每一行数据 for i, row in df.iterrows(): is_same = False for j, same_row in same_df.iterrows(): if row['author'] == same_row['author'] and similarity(row['org'], same_row['org']) > 0.8: is_same = True same_df.loc[j] = same_row.append(row) break if not is_same: unsame_df = unsame_df.append(row) # 保存同名和不同名的数据为Excel文件 same_df.to_excel(r'C:\Users\Admin\Desktop\same.xlsx', index=False) unsame_df.to_excel(r'C:\Users\Admin\Desktop\unsame.xlsx', index=False) print("同名的数据已保存为same.xlsx") print("不同名的数据已保存为unsame.xlsx") 这段代码 报错AttributeError: 'DataFrame' object has no attribute 'append' 如何修改
时间: 2024-04-12 17:30:54 浏览: 242
报错 "AttributeError: 'DataFrame' object has no attribute 'append'" 是因为在代码中使用了错误的 DataFrame 方法。DataFrame 对象没有 "append" 方法,无法直接将行添加到 DataFrame 中。
要修正这个问题,可以使用 `pd.concat()` 函数将行连接起来,然后重新赋值给 DataFrame。
以下是修正后的代码:
```python
import pandas as pd
from difflib import SequenceMatcher
# 读取Excel文件
df = pd.read_excel(r'C:\Users\Admin\Desktop\1000.xlsx')
# 比较相似度函数
def similarity(a, b):
return SequenceMatcher(None, str(a), str(b)).ratio()
# 创建同名和不同名的DataFrame
same_df = pd.DataFrame(columns=df.columns)
unsame_df = pd.DataFrame(columns=df.columns)
# 遍历每一行数据
for i, row in df.iterrows():
is_same = False
for j, same_row in same_df.iterrows():
if row['author'] == same_row['author'] and similarity(row['org'], same_row['org']) > 0.8:
is_same = True
same_df = pd.concat([same_df, row.to_frame().T], axis=0)
break
if not is_same:
unsame_df = pd.concat([unsame_df, row.to_frame().T], axis=0)
# 保存同名和不同名的数据为Excel文件
same_df.to_excel(r'C:\Users\Admin\Desktop\same.xlsx', index=False)
unsame_df.to_excel(r'C:\Users\Admin\Desktop\unsame.xlsx', index=False)
print("同名的数据已保存为same.xlsx")
print("不同名的数据已保存为unsame.xlsx")
```
在修正的代码中,使用 `pd.concat()` 函数将新的行连接到 DataFrame 中。将 `row.to_frame().T` 转换为 DataFrame,并通过 `axis=0` 参数进行行连接。
请确保将文件的保存路径修改为你想要保存的位置。
阅读全文