我正在尝试替换数据帧的一列中的值.列("女性")仅包含"女性"和"男性"的值.
我尝试过以下方法:
w['female']['female']='1'
w['female']['male']='0'
Run Code Online (Sandbox Code Playgroud)
但是收到以前结果的完全相同的副本.
理想情况下,我希望获得一些类似于以下循环元素的输出.
if w['female'] =='female':
w['female'] = '1';
else:
w['female'] = '0';
Run Code Online (Sandbox Code Playgroud)
我查看了陷阱文档(http://pandas.pydata.org/pandas-docs/stable/gotchas.html),但无法弄清楚为什么没有发生.
任何帮助将不胜感激.
我有大约2000个JSON文件,我试图通过Python程序运行.当JSON文件格式不正确时会出现问题.(错误:) ValueError: No JSON object could be decoded反过来,我无法将其读入我的程序.
我目前正在做类似下面的事情:
for files in folder:
with open(files) as f:
data = json.load(f); # It causes an error at this part
Run Code Online (Sandbox Code Playgroud)
我知道有验证和格式化JSON文件的离线方法,但是有一种编程方式来检查和格式化这些文件吗?如果没有,是否有一个免费/廉价的替代方法来离线修复所有这些文件,即我只是在包含所有JSON文件的文件夹上运行该程序,并根据需要格式化它们?
解决使用@reece的评论:
invalid_json_files = []
read_json_files = []
def parse():
for files in os.listdir(os.getcwd()):
with open(files) as json_file:
try:
simplejson.load(json_file)
read_json_files.append(files)
except ValueError, e:
print ("JSON object issue: %s") % e
invalid_json_files.append(files)
print invalid_json_files, len(read_json_files)
Run Code Online (Sandbox Code Playgroud)
事实证明我在我的工作目录中保存了一个不是JSON格式的文件,这是我从中读取数据的地方.感谢您提供有用的建议.
如果rows = nan或,我想从表中删除所有值0.
我知道有一种方法可以使用pandas来做到这一点,pandas.dropna(how = 'all')但我想要一个numpy方法来删除所有nan或的行0.
这是否有效实施?
我有一个数据集,需要省略几行,同时保留行的顺序.我的想法是使用一个掩码,在0我和我的数据集的长度之间有一个随机数,但是我不知道如何在不改变行周围的情况下设置掩码,即类似于采样数据集的方法.
示例:数据集有5行2列,我想随机删除一行.
Col1 | Col2
A | 1
B | 2
C | 5
D | 4
E | 0
Run Code Online (Sandbox Code Playgroud)
转换为:
Col1 | Col2
A | 1
B | 2
D | 4
E | 0
Run Code Online (Sandbox Code Playgroud)
Col1='C'随机选择省略第三行().
我该怎么办呢?
我正在尝试在我的本地计算机上安装Spark.我一直在关注这个指南.我已安装JDK-7(也有JDK-8)和Scala 2.11.7.当我尝试使用sbt构建时出现问题Spark 1.4.1.我得到以下异常.
NOTE: The sbt/sbt script has been relocated to build/sbt.
Please update references to point to the new location.
Invoking 'build/sbt assembly' now ...
Attempting to fetch sbt
Launching sbt from build/sbt-launch-0.13.7.jar
Error: Invalid or corrupt jarfile build/sbt-launch-0.13.7.jar
Run Code Online (Sandbox Code Playgroud)
我已经找到了解决这个问题的方法.我找到了一个很好的指南/sf/answers/2211809841/,它使用了预建版本.除了使用预建版本,有没有办法安装Spark使用sbt?此外,是否有原因导致Invalid or corrupt jarfile错误发生?
我正在尝试使用Selenium从Highcharts图表中获取数据.我对此的问题是该setExtremes函数不起作用.options.data.setExtremes使用纯Python基础方法后如何读取数据?
我的代码:
capabilities = webdriver.DesiredCapabilities().FIREFOX
capabilities["marionette"] = True
driver = webdriver.Firefox(capabilities=capabilities, executable_path=gecko_binary_path)
driver.get(website)
time.sleep(5)
temp = driver.execute_script('return window.Highcharts.charts[0].series[0]'
'.xAxis[0].setExtremes(Date.UTC(2017, 0, 7), Date.UTC(2017, 0, 8))'
'.options.data'
)
data = [item for item in temp]
print(data)
Run Code Online (Sandbox Code Playgroud) 我有一些Numpy代码,我试图破译.有一条线v1 = v1[:, a1.tolist()]传递一个numpy数组a1并将其转换为一个列表.我对v1[:, a1.tolist()]实际做的事感到困惑.我知道v1现在被设置v1为由选择给出的列数组[:, a1.tolist()]但是被选中的是什么?更确切地说,[:, a.tolist()]做什么?
我创建了一个名为 A 的表,需要将数据插入其中。
但是,由于某种原因,SQLite 找不到表中的最后一列。
错误:
OperationalError: table A has no column named Byte
Run Code Online (Sandbox Code Playgroud)
我的代码如下:
# Create the table
c.execute("DROP TABLE A;");
c.execute("""CREATE TABLE IF NOT EXISTS A
(id INTEGER PRIMARY KEY,
Col1 TEXT,
Col2 INTEGER,
Col3 TEXT,
Col4 TEXT,
Byte TEXT);""");
# Insert data into A
c.execute("""INSERT INTO A
(Col1, Col2, Col3, Col4, Byte) VALUES (?, ?, ?, ?, ?)""",
(Col1, Col2, Col3, Col4, Byte));
Run Code Online (Sandbox Code Playgroud)
注意:值 Col1、...、Col4、Byte 是由我的程序计算的,因此我需要一种动态方法来执行此操作。
另外,表 A 存储在我的磁盘上的哪里?我是否能够使用它进行查询,c.execute("SELECT * FROM A;");而无需CREATE TABLE在创建后重新运行命令 …
我想创建一个开始图标作为小部件中的Icon.add结束图标。例如,它们是预构建的动画,对应于开始动画 =和结束动画 = 。我想将结束动画更改为. 目前尚不清楚如何执行此操作,因为没有可用于创建自定义动画的文档。我能找到的最相关的代码是: https: //github.com/flutter/flutter/blob/e10df3c1a65f9d7db3fc5340cffef966f7bd40a6/packages/flutter/lib/src/material/animated_icons/data/add_event.g.dart。我相信我应该使用. 我怎样才能开始创建新的动画?Icon.closeAnimatedIconadd_eventaddeventIcon.closevitool
我正在处理一个包含来自 IoT 设备的数据的数据集,我发现隐马尔可夫模型非常适合我的用例。因此,我正在尝试更改我在此处找到的 Tensorflow 教程中的一些代码。与教程中显示的计数数据相比,数据集包含观察变量的实值。
特别是,我认为需要更改以下内容,以便 HMM 具有正态分布的发射。不幸的是,我找不到任何关于如何改变模型以具有除泊松以外的不同发射的代码。
我应该如何更改代码以发出正态分布的值?
# Define variable to represent the unknown log rates.
trainable_log_rates = tf.Variable(
np.log(np.mean(observed_counts)) + tf.random.normal([num_states]),
name='log_rates')
hmm = tfd.HiddenMarkovModel(
initial_distribution=tfd.Categorical(
logits=initial_state_logits),
transition_distribution=tfd.Categorical(probs=transition_probs),
observation_distribution=tfd.Poisson(log_rate=trainable_log_rates),
num_steps=len(observed_counts))
rate_prior = tfd.LogNormal(5, 5)
def log_prob():
return (tf.reduce_sum(rate_prior.log_prob(tf.math.exp(trainable_log_rates))) +
hmm.log_prob(observed_counts))
optimizer = tf.keras.optimizers.Adam(learning_rate=0.1)
@tf.function(autograph=False)
def train_op():
with tf.GradientTape() as tape:
neg_log_prob = -log_prob()
grads = tape.gradient(neg_log_prob, [trainable_log_rates])[0]
optimizer.apply_gradients([(grads, trainable_log_rates)])
return neg_log_prob, tf.math.exp(trainable_log_rates)
Run Code Online (Sandbox Code Playgroud) python machine-learning hidden-markov-models tensorflow tensorflow2.0
python ×8
pandas ×3
numpy ×2
apache-spark ×1
arrays ×1
flutter ×1
highcharts ×1
html ×1
javascript ×1
json ×1
sbt ×1
scala ×1
selenium ×1
sqlite ×1
tensorflow ×1