我正在尝试创建一个 SQL,以便我可以在 Google Data Studio 中通过 BigQuery 的连接制作一个时间序列图表。你可以在下面看到我的 SQL。
WITH
CTE_1 AS
(SELECT ID, Date, Min_Predict, Max_Predict, Interval
,ROW_NUMBER() OVER (PARTITION BY ID ORDER BY Date) AS row_num
FROM
table),
CTE_2 AS
(SELECT Date, Min_Predict, Max_Predict,
SUM(Min_Predict) OVER (ORDER BY Date) AS Min,
SUM(Max_Predict) OVER (ORDER BY Date) AS Max
FROM CTE_1
WHERE
row_num = 1 AND Interval = 'A')
SELECT Date, Min, Max
From CTE_2
GROUP BY Date, Min, Max
ORDER BY Date
Run Code Online (Sandbox Code Playgroud)
结果我得到了这张表。
Row ProgressDate EstMin EstMax
1 …Run Code Online (Sandbox Code Playgroud) 我已经用wget下载了数据
!wget http://nlp.stanford.edu/data/glove.6B.zip
- ‘glove.6B.zip’ saved [862182613/862182613]
Run Code Online (Sandbox Code Playgroud)
它另存为zip,我想使用zip文件中的Gloves.6B.300d.txt文件。我想要实现的是:
embeddings_index = {}
with io.open('glove.6B.300d.txt', encoding='utf8') as f:
for line in f:
values = line.split()
word = values[0]
coefs = np.asarray(values[1:],dtype='float32')
embeddings_index[word] = coefs
Run Code Online (Sandbox Code Playgroud)
我当然有这个错误:
IOErrorTraceback (most recent call last)
<ipython-input-47-d07cafc85c1c> in <module>()
1 embeddings_index = {}
----> 2 with io.open('glove.6B.300d.txt', encoding='utf8') as f:
3 for line in f:
4 values = line.split()
5 word = values[0]
IOError: [Errno 2] No such file or directory: 'glove.6B.300d.txt'
Run Code Online (Sandbox Code Playgroud)
如何在上面的Google colab代码中解压缩并使用该文件?
我正在练习熊猫和python,但我不太擅长循环。我有一个数据帧,如下所示:假设这是df:
Name Value
A [[A,B],[C,D]]
B [[A,B],[D,E]]
C [[D,E],[K,L],[M,L]]
D [[K,L]]
Run Code Online (Sandbox Code Playgroud)
我想遍历每一行,找到唯一的数组并计数。
我试过np.unique(a,return_index = True)然后返回两个不同的列表,我的问题我不知道如何遍历每个数组。
预期结果将是:
Value Counts
[A,B] 2
[D,E] 2
[K,L] 2
[C,D] 1
[M,L] 1
Run Code Online (Sandbox Code Playgroud)
非常感谢你。