我正在研究梁字数统计示例(用Python)。我能够在 DataflowRunner 上运行该示例并接收输出。
输出文件当前如下所示:
itself: 16
grey: 1
senses: 4
repair: 1
me: 228
Run Code Online (Sandbox Code Playgroud)
是否有办法对 PCollection 进行排序,以便我的输出文件根据词频按降序排序?
如果没有办法做到这一点,查找最常出现的单词的标准工作流程是什么?在 Beam 将数据减少到字数后,这是否会由单独的进程处理?
我很难理解为什么matplotlib想要将一个字符串转换为我的x轴浮点数.
x值(月/日)
x = ['Jul 01', 'Jul 02', 'Jul 03', 'Jul 04', 'Jul 05', 'Jul 06', 'Jul 07', 'Jul 08', 'Jul 09', 'Jul 10', 'Jul 11', 'Jul 12', 'Jul 13', 'Jul 14', 'Jul 15', 'Jul 16', 'Jul 17', 'Jul 18', 'Jul 19', 'Jul 20', 'Jul 21', 'Jul 22', 'Jul 23', 'Jul 24', 'Jul 25', 'Jul 26', 'Jul 27', 'Jul 28', 'Jul 29', 'Jul 30', 'Jul 31', 'Aug 01', 'Aug 02', 'Aug 03', 'Aug 04', 'Aug 05', 'Aug 06', 'Aug 07', …Run Code Online (Sandbox Code Playgroud) 我正在跟踪谷歌在TPU帖子上的对象检测,并且在培训方面遇到了障碍.
查看作业日志,我可以看到ml-engine为各种软件包运行了大量的pip安装,提供了TPU,然后提交以下内容:
Running command: python -m object_detection.model_tpu_main
--model_dir=gs://{MY_BUCKET}/train --tpu_zone us-central1
--pipeline_config_path=gs://{MY_BUCKET}/data/pipeline.config
--job-dir gs://{MY_BUCKET}/train
Run Code Online (Sandbox Code Playgroud)
它然后错误:
message: "Traceback (most recent call last):
File "/usr/lib/python2.7/runpy.py", line 174, in _run_module_as_main
"__main__", fname, loader, pkg_name)
File "/usr/lib/python2.7/runpy.py", line 72, in _run_code
exec code in run_globals
File "/root/.local/lib/python2.7/site-packages/object_detection/model_tpu_main.py", line 30, in <module>
from object_detection import model_lib
File "/root/.local/lib/python2.7/site-packages/object_detection/model_lib.py", line 26, in <module>
from object_detection import eval_util
File "/root/.local/lib/python2.7/site-packages/object_detection/eval_util.py", line 28, in <module>
from object_detection.metrics import coco_evaluation
File "/root/.local/lib/python2.7/site-packages/object_detection/metrics/coco_evaluation.py", line 20, in <module> …Run Code Online (Sandbox Code Playgroud) 我有一个应用程序,用户可以在其中选择要显示位置的特定主题。我将选定的主题objectID存储在NSUserDefaults中,以便在应用程序重新启动时,选定的主题仍将保持不变。
在整个应用程序中,我会参考此选定主题。我目前有一个用于保存objectID的类变量,但是有时我需要检索对象本身的属性(即name属性)。为此,我从核心数据中检索对象,然后访问我的值。
我担心这样做所需的处理时间,所以我的问题是-更好的选择是什么?
1)每次需要访问属性时,将objectID存储在内存中并查询核心数据以检索对象。我认为这在内存使用量较少的情况下比较便宜,但是在处理方面却比较昂贵。
2)将actaul对象存储在内存中,然后在需要时直接访问该对象。我认为这在处理方面更便宜,但在内存使用方面可能会更昂贵。