小编Mic*_*ael的帖子

Python不认为等效对象是等价的

我正在腌制,压缩和保存python对象.我希望能够仔细检查我保存的对象是否是在解压缩和去除后返回的完全相同的对象.我认为我的代码中有一个错误,但当我将问题归结为一个可重现的例子时,我发现python并不认为在两个不同的时间点创建的两个看似相同的对象是相等的.这是一个可重复的例子:

class fubar(object):
    pass

print(fubar() == fubar())
#False
Run Code Online (Sandbox Code Playgroud)

为什么python认为这两个对象不相等?检查两个对象确实相同的最pythonic方法是什么?

python logic class object

6
推荐指数
1
解决办法
389
查看次数

多处理中的Python日志记录:AttributeError:'Logger'对象没有属性'flush'

根据这段代码,我创建了一个python对象,它既将输出打印到终端,又将输出保存到日志文件中,并在其名称后附加日期和时间:

import sys
import time

class Logger(object):
    """
    Creates a class that will both print and log any
    output text. See https://stackoverflow.com/a/5916874
    for original source code. Modified to add date and
    time to end of file name.
    """
    def __init__(self, filename="Default"):
        self.terminal = sys.stdout
        self.filename = filename + ' ' + time.strftime('%Y-%m-%d-%H-%M-%S') + '.txt'
        self.log = open(self.filename, "a")

    def write(self, message):
        self.terminal.write(message)
        self.log.write(message)


sys.stdout = Logger('TestLog')
Run Code Online (Sandbox Code Playgroud)

这很好用,但是当我尝试将它与使用Pool多处理功能的脚本一起使用时,我收到以下错误:

AttributeError: 'Logger' object has no attribute 'flush'
Run Code Online (Sandbox Code Playgroud)

如何修改我的Logger …

python logging multiprocessing

6
推荐指数
1
解决办法
1万
查看次数

大多数pythonic方法导入模块中的所有对象作为模块中的名称

导入模块时,python通过导入该模块中的所有对象来保护命名空间,module.objectname而不是objectname.import module.objectname as objectname将在模块中导入对象作为其原始名称,但以这种方式写出每个对象对于大型模块来说将是乏味的.导入模块中所有对象作为模块中名称的最pythonic方法是什么?

python python-import

5
推荐指数
1
解决办法
151
查看次数

使用pyPdf识别PDF中的粗体文本

pyPdf用来从PDF中提取文本.我希望能够知道哪个文本是粗体,以便识别粗体节标题.如何识别粗体文字?

python pypdf

5
推荐指数
1
解决办法
583
查看次数

带有RPYC的多处理Python“ ValueError:禁用酸洗”

我试图在rpyc服务中使用多处理程序包,但是ValueError: pickling is disabled当我尝试从客户端调用公开函数时会得到提示。我知道该multiprocesing程序包使用酸洗在进程之间传递信息,并且不允许酸洗,rpyc因为这是不安全的协议。因此,我不确定将多处理与rpyc一起使用的最佳方法(或者是否存在)。如何在rpyc服务中使用多重处理?这是服务器端代码:

import rpyc
from multiprocessing import Pool

class MyService(rpyc.Service):

    def exposed_RemotePool(self, function, arglist):

        pool = Pool(processes = 8)
        result = pool.map(function, arglist)
        pool.close()
        return result


if __name__ == "__main__":
    from rpyc.utils.server import ThreadedServer
    t = ThreadedServer(MyService, port = 18861)
    t.start()
Run Code Online (Sandbox Code Playgroud)

这是产生错误的客户端代码:

import rpyc

def square(x):
    return x*x

c = rpyc.connect("localhost", 18861)
result = c.root.exposed_RemotePool(square, [1,2,3,4])
print(result)
Run Code Online (Sandbox Code Playgroud)

python multiprocessing rpyc python-multiprocessing

5
推荐指数
1
解决办法
1314
查看次数

在函数内将参数传递给 R 中的 lm

我希望能够lm在函数内调用并将weights变量指定为传递给外部函数的参数,然后传递给lm. 下面是一个可重现的示例,如果调用lm在函数外部进行,则调用有效,但从Error in eval(expr, envir, enclos) : object 'weightvar' not found包装函数内部调用时会产生错误消息。

olswrapper <- function(form, weightvar, df){
  ols <- lm(formula(form), weights = weightvar, data = df)
  }

df <- mtcars

ols <- lm(mpg ~ cyl + qsec,  weights = gear, data = df)
summary(ols)

ols2 <- olswrapper(mpg ~ cyl + qsec,  weightvar = gear, df = df)
#Produces error: "Error in eval(expr, envir, enclos) : object 'weightvar' not found"
Run Code Online (Sandbox Code Playgroud)

r lm

5
推荐指数
1
解决办法
2944
查看次数

为什么函数内的这个 DataFrame 修改会改变全局外函数?

为什么下面的函数会改变全局DataFrame命名df?它不应该只更改df函数内的局部变量,而不是全局变量df吗?

import pandas as pd

df = pd.DataFrame()

def adding_var_inside_function(df):
    df['value'] = 0

print(df.columns) # Index([], dtype='object')
adding_var_inside_function(df)
print(df.columns) # Index([u'value'], dtype='object')
Run Code Online (Sandbox Code Playgroud)

python global local pandas

5
推荐指数
1
解决办法
2609
查看次数

访问 Sagemaker 笔记本实例上的 Flask 开发服务器

我希望能够在 sagemaker 笔记本实例上运行正在开发的 Flask 应用程序,然后在浏览器中查看 Flask 应用程序。我知道我以前能够通过打开我的 IP 端口来在 ec2 上配置这种访问,但我没有找到任何如何在 sagemaker 上执行此操作的方法,否则它会附带好的用户界面。如何访问在 Sagemaker 笔记本实例上运行的 Flask 应用程序?一般来说,一旦 Flask 应用程序使用的数据库位于 Amazon RDS 中,我就很难找到它的开发框架。

python amazon-rds flask amazon-sagemaker

5
推荐指数
0
解决办法
1019
查看次数

Python SQLAlchemy Query:AttributeError:'Connection'对象没有属性'contextual_connect'

我试图从如何在python中创建条目和查询MYSQL数据库的本教程SQLAlchemy.当我第一次尝试查询数据库时,在添加新对象部分以测试是否已将对象添加到数据库中(请参阅下面的大代码块),我收到以下错误:AttributeError: 'Connection' object has no attribute 'contextual_connect'

我可以查询数据库.例如,如果我将最后一行代码更改our_user = session.query(User).filter_by(name='ed')为成功返回查询对象,但我无法弄清楚如何从此查询结果中获取我输入数据库的对象.

同样,如果我尝试按照他们在查询 部分中建议的结果循环:

for instance in session.query(User).order_by(User.id):
    print instance.name, instance.fullname
Run Code Online (Sandbox Code Playgroud)

我犯了同样的错误.我该如何修复这个特定的错误,是否有任何其他关于在Python中使用MYSQL和SQLAlchemy的教程,你可以指点我?

我的代码:

import MySQLdb
from sqlalchemy import create_engine

db1 = MySQLdb.connect(host="127.0.0.1",
                      user="root",
                      passwd="****",
                      db="mydata")



from sqlalchemy.ext.declarative import declarative_base

Base = declarative_base()

from sqlalchemy import Column, Integer, String

class User(Base):
    __tablename__ = 'users'

    id = Column(Integer, primary_key=True)
    name = Column(String)
    fullname = Column(String)
    password = Column(String)

    def __init__(self, name, fullname, password):
        self.name = …
Run Code Online (Sandbox Code Playgroud)

python mysql database orm sqlalchemy

4
推荐指数
1
解决办法
2万
查看次数

在复制之后但在编辑复制之前编辑原始DataFrame会更改复制

我试图了解如何复制pandas数据框.当我在python中分配对象的副本时,我不习惯更改影响该对象副本的原始对象.例如:

x = 3
y = x
x = 4
print(y)
3
Run Code Online (Sandbox Code Playgroud)

虽然x随后发生了变化,但仍然保持不变.相反,当我将pandas df分配给副本后对其进行更改时df1,副本也会受到原始DataFrame更改的影响.

import pandas as pd
import numpy as np

def minusone(x):
    return int(x) - 1

df = pd.DataFrame({"A": [10,20,30,40,50], "B": [20, 30, 10, 40, 50], "C": [32, 234, 23, 23, 42523]})

df1 = df


print(df1['A'])

0    10
1    20
2    30
3    40
4    50
Name: A, dtype: int64

df['A'] = np.vectorize(minusone)(df['A'])

print(df1['A'])

0     9
1    19
2    29
3    39
4 …
Run Code Online (Sandbox Code Playgroud)

python numpy pandas

4
推荐指数
1
解决办法
3323
查看次数