我有一个简单的问题要问。我在 SO 上找不到解决方案。
我有一个日期列向量,我想看看月份是否唯一。我尝试使用,unique但我可能以错误的方式使用它。
一个例子:
Date = structure(c(11690, 11725, 11753, 11781, 11809, 11844, 11872,
11900, 11942, 11970, 11998, 12026, 12061, 12089, 12117, 12145,
12180, 12208, 12243, 12264, 12265, 12299, 12327, 12362, 12390,
12425, 12453, 12481, 12509, 12544, 12572, 12600, 12635, 12663,
12698, 12726, 12754, 12796, 12817, 12845, 12880, 12907, 12936,
12971, 12999, 13027, 13062, 13090, 13118, 13160, 13181, 13209,
13244, 13272, 13307, 13335, 13363, 13392, 13426, 13454, 13489,
13524, 13552, 13580, 13615, 13643, 13670, 13699, 13727, 13762,
13790, …Run Code Online (Sandbox Code Playgroud) 我有两个数据框:
daily = pd.DataFrame({'Date': pd.date_range(start="2021-01-01",end="2021-04-29")})
pc21 = pd.DataFrame({'Date': ["2021-01-21", "2021-03-11", "2021-04-22"]})
pc21['Date'] = pd.to_datetime(pc21['Date'])
Run Code Online (Sandbox Code Playgroud)
我想要做的是:对于 in 中的每个日期,如果 in中的pc21日期在中,我想在新列中获得该日期后 8 天的值等于 1,否则为 0。pc21daily
这是所需输出的示例:
# 2021-01-21 is in either daframes so I want a new column in 'daily' that looks like this:
Date newcol
.
.
.
2021-01-20 0
2021-01-21 1
2021-01-22 1
2021-01-23 1
2021-01-24 1
2021-01-25 1
2021-01-26 1
2021-01-27 1
2021-01-28 1
2021-01-29 0
.
.
.
Run Code Online (Sandbox Code Playgroud)
谁能帮助我实现这个目标?
谢谢!
我在 R 中阅读了一些 txt 文件。由于某些原因,文本的顺序已更改。现在,我想重新排序数据框。这肯定是愚蠢的,但我被困在这个问题上,我无法在以前的答案中找到我需要的东西。
让我们以这个例子为例,我有以下情况:
df <- data.frame(doc_id = c(3, 10, 7, 1, 5, 2, 8, 4, 6, 9), Text = c("Text Text", "Text Stackoverflow", "Text Nice", "Text", "Text Not Nice", "Text Help", "Text Great", "Text programming", "Text Bad", "Text Example"))
doc_id Text
1 3 Text Text
2 10 Text Stackoverflow
3 7 Text Nice
4 1 Text
5 5 Text Not Nice
6 2 Text Help
7 8 Text Great
8 4 Text programming
9 6 Text Bad …Run Code Online (Sandbox Code Playgroud) 我想将 R 中日期对象中的不同日期替换为所有对象的同一天。
让我们举个例子。
date = structure(c(10961, 10990, 11018, 11046, 11060, 11088, 11116,
11144, 11214, 11235, 11249, 11263, 11305, 11354, 11382, 11423,
11452, 11480, 11494, 11508), class = "Date")
[1] "2000-01-05" "2000-02-03" "2000-03-02" "2000-03-30" "2000-04-13" "2000-05-11" "2000-06-08"
[8] "2000-07-06" "2000-09-14" "2000-10-05" "2000-10-19" "2000-11-02" "2000-12-14" "2001-02-01"
[15] "2001-03-01" "2001-04-11" "2001-05-10" "2001-06-07" "2001-06-21" "2001-07-05"
Run Code Online (Sandbox Code Playgroud)
我想得到:
[1] "2000-01-05" "2000-02-05" "2000-03-05" "2000-03-05" "2000-04-05" "2000-05-05" "2000-06-05"
[8] "2000-07-05" "2000-09-05" "2000-10-05" "2000-10-05" "2000-11-05" "2000-12-05" "2001-02-05"
[15] "2001-03-05" "2001-04-05" "2001-05-05" "2001-06-05" "2001-06-05" "2001-07-05"
Run Code Online (Sandbox Code Playgroud)
我所做的是:
sub("%d", "05", date, …Run Code Online (Sandbox Code Playgroud) 愚蠢的问题(但无法在线找到解决方案):我想将默认列从1到N排序。
这是我正在处理的数据框:
Ngrams Counts Lambda Z
5558 willem f 121 17.97538 11.583211
8095 inter alia 15 17.52591 8.693128
8122 PRESS conferencemario 14 17.45922 8.655312
8325 boca raton 10 17.13645 8.468008
8524 dei paschi 7 16.79998 8.263397
Run Code Online (Sandbox Code Playgroud)
如您所见,默认列没有顺序(5558、8095、8122等)。因此,我想订购1到N。
我已经尝试过使用factor和stulevel没有结果。
我该如何解决呢?
非常感谢!
我有以下字典。
dct = {'hello':1.9,'ciao':1.5,'yes':-2,'no':-3}
Run Code Online (Sandbox Code Playgroud)
我想用 1 替换正值,用 -1 替换负值。
我尝试了很多代码,其中之一如下:
np.where(dct.values() > 0, 1, 0)
np.where(dct.values() > 0, -1, 0)
Run Code Online (Sandbox Code Playgroud)
然而,它并没有成功。我该怎么做?
谢谢!