小编Nat*_*ton的帖子

如何将 Pandas DataFrame 更新到 PostgreSQL 表?

我从网络资源中抓取了一些数据并将它们全部存储在 Pandas DataFrame 中。现在,为了利用 SQLAlchemy 提供的强大的数据库工具,我想将所述 DataFrame 转换为 Table() 对象,并最终将所有数据 upsert 到 PostgreSQL 表中。如果这是可行的,那么完成这项任务的可行方法是什么?

python postgresql sqlalchemy upsert pandas

6
推荐指数
2
解决办法
4267
查看次数

优化 pandas 操作:合并名字/中间/姓氏列

假设我抽取了一些名称样本,例如由各个字段分隔的名称:

indx  First Name   Middle Name     Last Name
0     CHARITIXAN   K.R.,           NICHOLS
1           None   Johnny-Boy      CHAVEZ
2          ISAAC   None            ESPARZA
3        MICHAEL   nan             
4         Andrew                   Pfaff
Run Code Online (Sandbox Code Playgroud)

我们还假设这些数据被格式化为 pandas 数据帧 (df),并且.replace已经进行了足够的清理(通过该方法),剩下的所有值仅是占用的字符串或空字符串。

indx  First Name   Middle Name     Last Name
0     CHARITIXAN   K.R.,           NICHOLS
1                  Johnny-Boy      CHAVEZ
2          ISAAC                   ESPARZA
3        MICHAEL               
4         Andrew                   Pfaff
Run Code Online (Sandbox Code Playgroud)

我想正确地将给定名称的所有部分组合在一起,每个名称段之间只有一个空格。根据我的研究和实施,我发现的最好的解决方案是这样的——使用了我们的解决方案re。这是最佳方法还是对于这种特殊情况有更好的方法?

我的最终方法是这样的:

df['full_name']=df[['First Name', 'Middle Name', 'Last Name']].apply(lambda x: re.sub(' +', ' ', ' '.join(x)), axis=1)
Run Code Online (Sandbox Code Playgroud)

python lambda apply pandas

1
推荐指数
1
解决办法
4138
查看次数

标签 统计

pandas ×2

python ×2

apply ×1

lambda ×1

postgresql ×1

sqlalchemy ×1

upsert ×1