小编ker*_*mat的帖子

如果元组具有相同的第一个元素,如何聚合元组列表的元素?

我有一个列表,其中每个值是一个元组列表.例如,这是我为密钥提取的值:

     [('1998-01-20',8) , ('1998-01-22',4) , ('1998-06-18',8 ) , ('1999-07-15' , 7), ('1999-07-21',1) ]
Run Code Online (Sandbox Code Playgroud)

我也对列表进行了排序.现在我想聚合这样的值:

    [('1998-01' , 12 ) , ('1998-06' ,8 ) , ('1999-07',8 )]
Run Code Online (Sandbox Code Playgroud)

从某种意义上说,我想按月分组我的元组,一起总结每个月的整数,我读过有关groupby的内容,我认为它对我的数据结构无法帮助,因为我不知道我会做什么面对我的列表,所以我想找个方法说:如果i [0] [:6]相等,从元组的第一个元素开始:sum i [1].但是我很难实现这个想法.

    for i in List :
        if i[0][:6] # *problem* I don't know how to say my condition :
        s=sum(i[1]) #?
Run Code Online (Sandbox Code Playgroud)

我很感激任何建议,因为我是python的新用户!

python aggregate list

11
推荐指数
2
解决办法
1万
查看次数

在整个数据集上还是仅在训练数据上计算TF-IDF?

在本书“ TensorFlow机器学习指南”的第七章中,作者在数据预处理中使用fit_transformscikit-learn的tfidf功能来获取文本的特征进行训练。作者将所有文本数据提供给函数,然后再将其分为训练和测试。这是真的吗?还是我们必须先分离数据,然后再进行fit_transform训练和transform测试?

nlp machine-learning tf-idf scikit-learn tensorflow

9
推荐指数
1
解决办法
4123
查看次数

“pyuic5”不被识别为内部或外部命令

我正在尝试将 QTDesigner 创建的 ui 文件转换为 py 文件。但我收到错误: pyuic5 未被识别为内部或外部命令。我使用 anaconda 3,并尝试了这里的所有建议:

C:/程序无法识别...与 pyuic5 相关。

我在这里看到:

“Pyuic4”未被识别为内部外部命令。

python pyqt pyqt4 pyqt5 pyuic

5
推荐指数
2
解决办法
6万
查看次数

python-docx,获取段落字体大小

我想使用 python-docx 访问具有唯一字体或字体大小的段落或运行。我如何获取具有指定字体或字体大小的运行或段落的文本?

python ms-word docx python-docx

5
推荐指数
1
解决办法
3653
查看次数

\u200c 而不是真正的半空间

我正在用 python 抓取一些 HTML 页面。某些空格中的文本具有半空格字符 (\u200c)。当我在变量中使用文本时,一切正常。问题是当我将文本添加到列表中时,它显示“\u200c”而不是真正的半空间。问题是什么?

python

4
推荐指数
1
解决办法
9934
查看次数

Tkinter从右到左菜单

我正在使用python和tkinter编写GUI程序.我想从右到左放置菜单项.可能吗?我试过网格,但我得到错误'这是一个顶级窗口'.

import tkinter as tk
from tkinter import ttk
from tkinter import Menu
from tkinter import LEFT, RIGHT
from tkinter import W
menuBar = Menu(win)
win.config(menu=menuBar)
fileMenu = Menu(menuBar, tearoff=0).grid(sticky=W)
menuBar.add_cascade(label="File", menu=fileMenu)
fileMenu.add_command(label="New")
Run Code Online (Sandbox Code Playgroud)

python tkinter

3
推荐指数
2
解决办法
858
查看次数

如何解释 APScheduler 中从 get_jobs 返回的作业列表?

我试图弄清楚 APScheduler 是否是满足我的项目需求的工具。

我可以添加一个工作。

我可以获得一份工作清单,但我无法解释结果。我想让我的程序将返回的作业列表转换为程序其他部分所需的格式。我需要提取触发参数。

假设我正在使用 cron 触发器。我现在先做一个简单的:

new_job = self.scheduler.add_job(jobfunc,'cron', minute='*/5', args=["minute"]
Run Code Online (Sandbox Code Playgroud)

后来,我想获取作业,然后提取基本信息(这是一个 cron 触发器,它被安排为“分钟”=*/5)——基本上我想重建创建触发器的参数。

我查看了调试器中返回的作业,我发现每个作业都有一个“触发器”成员,其中包含我需要的信息 - 但我不确定如何以编程方式访问它。

我想做这样的事情:

    jobs=self.scheduler.get_jobs()
    schedules=[]
    for job in jobs:
        schedules.append(<do something with job.trigger.fields>)
Run Code Online (Sandbox Code Playgroud)

附加到时间表的元素看起来像:

{'minute':'*/5'}
Run Code Online (Sandbox Code Playgroud)

文档说:

要获取机器可处理的计划作业列表,您可以使用 get_jobs()。

问题是,我的“机器”应该如何处理这个列表?

python apscheduler

2
推荐指数
1
解决办法
2万
查看次数

Twython 的 twitter 字符数限制为 140 个

我正在尝试使用 Tython 在 twitter 中搜索,但该库似乎有 140 个字符的限制。python的新特性,即280个字符长度,能做什么呢?

python twitter social-networking web-scraping twython

1
推荐指数
1
解决办法
1288
查看次数

运行时错误:找不到二进制“sox”

我正在使用谷歌语音库,如下所示:

from google_speech import Speech

# say "Hello World"
text = "Hello World"
lang = "en"
speech = Speech(text, lang)
speech.play()
Run Code Online (Sandbox Code Playgroud)

收到此错误:

RuntimeError                          

    Traceback (most recent call last)
<ipython-input-2-4daa3294f636> in <module>()
----> 1 from google_speech import Speech
      2 
      3 # say "Hello World"
      4 text = "Hello World"
      5 lang = "en"

D:\soft\Ins\anac\lib\site-packages\google_speech\__init__.py in <module>()
    321 
    322 # check deps
--> 323 bin_dep.check_bin_dependency(("sox",))
    324 
    325 

D:\soft\Ins\anac\lib\site-packages\google_speech\bin_dep.py in check_bin_dependency(bins)
      5   for bin in bins:
      6     if shutil.which(bin) is None:
----> 7 …
Run Code Online (Sandbox Code Playgroud)

python windows speech-recognition sox

1
推荐指数
1
解决办法
9548
查看次数