我正在使用google colaboratory用python教授数据科学,为了让笔记本只留给学生的特定课程,我想导入一些我们编码的基本方法,而不是给他们一个预先填充这些方法的大笔记本防止任何分心.
如何导入这些方法而不在pip上发布它们?可以从github google-colaborary pip安装吗?
对我们来说最好的选择是能够在Drive中获得代码并将模块上传到colab空间,就像我们使用csv文件一样,并使用标准导入.那可能吗?
我通常perl -de 42用于获取交互式Perl shell.我见过 Devel :: REPL,我看过一些像http://www.xenoterracide.com/2010/07/making-repl-usable.html这样的博客, 解释了如何Devel::REPL使用插件进行增强,但我还没有使用过.
将调试器用作交互式shell是否太糟糕了?为什么?
注意:此PerlMonks节点中提到的缺点是用户的限制,而不是Perl调试器的限制.
我在哪里可以阅读有关Perl REPL的更多信息?
Devel :: REPL是否准备好迎接风头?
更新: 我接受了Pedro的答案,因为它回答了我问的问题,但我仍然想知道何时以及为什么(如果有的话)使用Perl调试器作为交互式shell与其中一个Perl相比是一个坏主意REPL实现.您更喜欢哪种Perl REPL?
我正在使用带有RSE的eclipse,当我在同一个网络时,它可以很好地连接到我的linux服务器,但由于服务器位于带有门入口的防火墙后面,我需要在其网络外部进行ssh隧道.
我还没有找到一种方法可以将我拥有隧道的本地端口添加到主机名,也无法在其他地方添加.

是否可以使用RSE连接到localhost:port?
当我做M-!在我的emacs 21.4中,ANSI代码是文字的.例如:ls --color
^[[0m^[[0m05420273.pdf^[[0m
^[[0m100829_Baño1.pdf^[[0m
Run Code Online (Sandbox Code Playgroud)
有没有办法让它与颜色和UTF8?
SO之前已经回答了同样的问题,但结果并不完全令人满意(给出的解决方案是打开shell模式).我知道如何在shell中使用颜色.我只想知道我怎么能用M做颜色!(shell-command)或者根本不可能.
当你只想快速显示某些东西并且不想移动到这个缓冲区并且你想让它在没有Cxk的情况下自动消失时,shell模式就太过于干扰.显然有些情况下shell缓冲区更方便但是由于另一个问题,我发现如何将颜色添加到shell模式.
[注意] emacs正在使用GNU Emacs 21.4.1(x86_64-redhat-linux-gnu,X工具包,Xaw3d滚动条)于2008-06-15在builder6.centos.org上
在emacs下使用ESS编写R代码时,使用'_'替换为' - '的默认行为是很有用的(插入两个连续的'_'会插入下划线本身).但是当将代码粘贴到ESS模式中的任何缓冲区时,此替换也会发生,并且任何"_"都会被"< - "替换,这不是我想要的行为.
有没有办法只在粘贴文本时阻止替换?
目前,我已完全禁用替换,将此代码添加到我的.emacs中
(ess-toggle-underscore nil)
Run Code Online (Sandbox Code Playgroud)
但是我想将'_'恢复为'< - '替换,只有在写作时才能粘贴.
任何的想法?
我有一个DataFrame,我想将几个列从'object'类型更改为'category'.
我可以同时更改几列用于浮动,
dftest[['col3', 'col4', 'col5', 'col6']] = \
dftest[['col3', 'col4', 'col5', 'col6']].astype(float)
Run Code Online (Sandbox Code Playgroud)
对于'类别'我不能这样做,我需要一个接一个地做(或像这里一样循环).
for col in ['col1', 'col2']:
dftest[col] = dftest[col].astype('category')
Run Code Online (Sandbox Code Playgroud)
问题:是否有任何方法可以像"浮动"示例一样对所有想要的列进行更改?
如果我尝试同时做几个列,我有:
dftest[['col1','col2']] = dftest[['col1','col2']].astype('category')
## NotImplementedError: > 1 ndim Categorical are not supported at this time
Run Code Online (Sandbox Code Playgroud)
我目前的工作测试代码:
import numpy as np
import pandas as pd
factors= np.array([
['a', 'xx'],
['a', 'xx'],
['ab', 'xx'],
['ab', 'xx'],
['ab', 'yy'],
['cc', 'yy'],
['cc', 'zz'],
['d', 'zz'],
['d', 'zz'],
['g', 'zz']
])
values = np.random.randn(10,4).round(2)
dftest = pd.DataFrame(np.hstack([factors,values]),
columns = …Run Code Online (Sandbox Code Playgroud) 在cperl模式中,我可以使用M-x customize-group RET cperl-faces RET和更改Cperl Hash Face和更改数组和哈希面Cperl Hash Face.但我看不到任何改变标量变量颜色的选项.
我试图改变font-lock-variable-name-face代码内部或从Cperl Ps Print Face Properties(我真的想改变颜色在打印中),但它不起作用.我已经尝试了从4.32到rockway-perl6-branch的几种cperl模式.
此外,我不想在变量中使用$ color,因此sigil在打印输出中会更好(这已经在这里被问到但是没有解决).
有人可以给我任何提示吗?
如何将文本添加到使用geom_jittered渲染的点以标记它们?geom_text不起作用,因为我不知道抖动点的坐标.你能捕捉到抖动点的位置,以便传递给geom_text吗?
我的实际用法是绘制一个带有geom_jitter的boxplot来显示数据分布,我想标记异常点或符合特定条件的那些(例如,用于颜色的值的下限为10%) ).
一种解决方案是捕获抖动图的xy位置,稍后在另一层使用它,这可能吗?
从Joran的回答中,解决方案是使用基本包中的抖动函数计算抖动值,将它们添加到数据帧并将其与geom_point一起使用.对于过滤,他使用ddply来获得一个过滤列(逻辑向量)并使用它来对geom_text中的数据进行子集化.
他要求提供最小的数据集.我刚刚修改了他的例子(标签列中的唯一标识符)
dat <- data.frame(x=rep(letters[1:3],times=100),y=runif(300),
lab=paste('id_',1:300,sep=''))
Run Code Online (Sandbox Code Playgroud)
这是我的数据的joran示例的结果,并将ID的显示降低到最低的1%

这是对代码的修改,使其具有另一个变量的颜色并显示该变量的一些值(每个组的最低1%):
library("ggplot2")
#Create some example data
dat <- data.frame(x=rep(letters[1:3],times=100),y=runif(300),
lab=paste('id_',1:300,sep=''),quality= rnorm(300))
#Create a copy of the data and a jittered version of the x variable
datJit <- dat
datJit$xj <- jitter(as.numeric(factor(dat$x)))
#Create an indicator variable that picks out those
# obs that are in lowest 1% by x
datJit <- ddply(datJit,.(x),.fun=function(g){
g$grp <- g$y <= quantile(g$y,0.01);
g$top_q <- g$qual <= quantile(g$qual,0.01);
g})
#Create a boxplot, overlay the jittered …Run Code Online (Sandbox Code Playgroud) 每当我更新我的一个git repo并获取一个新的分支或提交时,我想用特定分支中的那些替换两个新文件.
我知道我可以通过结账来做到这一点,但......
有什么区别
git checkout wanted_branch file_wanted
Run Code Online (Sandbox Code Playgroud)
和
git checkout --merge wanted_branch file_wanted
Run Code Online (Sandbox Code Playgroud)
?
我从选项卡文件导入数百万行,而SQLite .import .mode选项卡非常慢.我有三个索引,所以可能是索引的缓慢.但首先我要检查.import是否将批次/所有这些行分组到一个提交中.我无法找到.import如何工作的文档.有人知道吗?如果索引是问题(我之前遇到过mysql问题)如何在.import结束时禁用它并重新索引?
关注@sixfeetsix评论.
我的架构是:
CREATE TABLE ensembl_vf_b36 (
variation_name varchar(20),
chr varchar(4),
start integer,
end integer,
strand varchar(5),
allele_string varchar(3),
map_weight varchar(2),
flags varchar(50),
validation_status varchar(100),
consequence_type varchar(50)
);
CREATE INDEX pos_vf_b36_idx on ensembl_vf_b36 (chr, start, end);
Run Code Online (Sandbox Code Playgroud)
数据:
rs35701516 NT_113875 352 352 1 G/A 2 NULL NULL INTERGENIC
rs12090193 NT_113875 566 566 1 G/A 2 NULL NULL INTERGENIC
rs35448845 NT_113875 758 758 1 A/C 2 NULL NULL INTERGENIC
rs17274850 NT_113875 1758 1758 1 G/A 2 genotyped cluster,freq INTERGENIC …Run Code Online (Sandbox Code Playgroud)