小编Ame*_*ina的帖子

Emacs:使用Mx ansi-term运行的默认二进制文件

有没有办法让Emacs在运行时默认提示我选择的二进制文件M-x ansi-term.它总是要求我,/bin/zsh但我有一个新的安装zsh在不同的路径.

或者,让Emacs在我键入时运行我想要的二进制文件会很棒 M-x my-ansi-term

emacs zsh ansi-term

11
推荐指数
1
解决办法
2184
查看次数

NumPy中行与列操作的性能

一些文章表明MATLAB比列操作更喜欢列操作,而且根据您布置数据的不同,性能会有很大差异.这显然是因为MATLAB使用列主要顺序来表示数组.

我记得读过Python(NumPy)使用行主要顺序.有了这个,我的问题是:

  1. 在使用NumPy时,可以预期性能会有类似的差异吗?
  2. 如果上面的答案是肯定的,那么突出这种差异的一些例子是什么?

python benchmarking numpy

11
推荐指数
2
解决办法
4008
查看次数

PyData生态系统

我已经在一些地方(例如这里)阅读了有关PyData的内容,但我仍然对这个术语的含义感到困惑.

PyData是官方实体吗?(例如,是否有一个拥有/支持PyData.org的基金会?).这只是一次会议吗?或者它是否主要用于松散地引用Python包列表?

哪些包被认为是PyData生态系统的核心部分?它只是可用于处理数据的任何包吗?(那将是非常通用的).我发现的一些软件包通常与PyData相关联:

此列表是否与通常与PyData关联的包组一致?或者有任何重要的遗漏?

最后,PyData生态系统在多大程度上支持Python 3.x?假设大多数PyData生态系统与Python 3.x兼容是否安全?如果没有,哪些包不支持呢?

python numpy scipy

11
推荐指数
1
解决办法
3084
查看次数

SettingWithCopyWarning,即使使用loc(?)

SettingWithCopyWarning在我不期望它们的情况下我会遇到错误:

N.In <38>: # Column B does not exist yet
N.In <39>: df['B'] = df['A']/25
N.In <40>: df['B'] = df['A']/50

/Users/josh/anaconda/envs/py27/lib/python2.7/site-packages/pandas/core/indexing.py:389: SettingWithCopyWarning: A value is trying to be set on a copy of a slice from a DataFrame.
Try using .loc[row_index,col_indexer] = value instead
  self.obj[item] = s
Run Code Online (Sandbox Code Playgroud)

N.In <41>: df.loc[:,'B'] = df['A']/50

/Users/josh/anaconda/envs/py27/lib/python2.7/site-packages/pandas/core/indexing.py:389: SettingWithCopyWarning: A value is trying to be set on a copy of a slice from a DataFrame.
Try using .loc[row_index,col_indexer] = value instead
  self.obj[item] = …
Run Code Online (Sandbox Code Playgroud)

python pandas

11
推荐指数
2
解决办法
5225
查看次数

从熊猫时间戳转换时区

我在数据帧中有以下内容:

> df['timestamps'].loc[0]
Timestamp('2014-09-02 20:24:00')
Run Code Online (Sandbox Code Playgroud)

我知道它使用的时区(我认为它是GMT)并希望将整个列转换为EST.我怎么能在熊猫那里做到这一点?

作为参考,我发现了这些其他线程:

但他们使用datetime时间戳.例如:

> datetime.datetime.fromtimestamp(df['timestamps'].loc[0], tz=None)
returns:

TypeError                                 Traceback (most recent call last)
----> 2 datetime.datetime.fromtimestamp(ts, tz=None)

TypeError: an integer is required (got type Timestamp)
Run Code Online (Sandbox Code Playgroud)

python timezone pandas

11
推荐指数
2
解决办法
2万
查看次数

在MATLAB中将所有数字移动到特定的监视器

我想知道是否有任何已知的方法将MATLAB数字移动到特定的监视器.

我有以下代码片段可以帮助我将所有数据放到前面(我从Mathworks 这里得到它):

%% Bring all figures to front
all_figure_handles = findall(0, 'type', 'figure');
for iCount = length(all_figure_handles):-1:1
   figure(all_figure_handles(iCount))
end
Run Code Online (Sandbox Code Playgroud)

我想知道我是否可以要求MATLAB以类似的方式将所有数字移动到另一个屏幕(即使用手柄all_figure_handles).

或者,如果MATLAB不知道监视器分区,我怎么能将所有数字移动到总屏幕空间的右半部分?(在我的情况下,右半部分应该是右侧的监视器).

matlab

10
推荐指数
1
解决办法
4474
查看次数

在GitHub的Wiki上突出显示语法:指定编程语言

GitHub使用称为"GitHub Flavored Markdown"的消息,问题和评论.我的问题是:

  • GitHub是否也将这种语法用于他们的Wiki?
  • 根据我的理解,可以使用以下语法指定语法高亮的编程语言:

    ```ruby  
    require 'redcarpet'  
    markdown = Redcarpet.new("Hello World!")  
    puts markdown.to_html  
    ```
    
    Run Code Online (Sandbox Code Playgroud)

    可以在```字符串后面指定编程语言(例如```ruby)

    我的问题是:如何查找编程语言的说明符?(例如C,似乎不适用于C编程语言)

markdown github github-linguist

10
推荐指数
2
解决办法
4418
查看次数

py4J最简单的例子

我在Python中py4J使用pip在我的conda虚拟环境中安装.我写了一个超级简单的例子AdditionApplication.java来测试py4J,但它无法编译,即

javac AdditionApplication.java

没有抱怨 GatewayServer没有定义.

我对Python很了解,但遗憾的是不是Java.我还需要提供什么?

public class AdditionApplication {

  public int addition(int first, int second) {
    return first + second;
  }

  public static void main(String[] args) {
    AdditionApplication app = new AdditionApplication();
    // app is now the gateway.entry_point
    GatewayServer server = new GatewayServer(app);
    server.start();
  }
}
Run Code Online (Sandbox Code Playgroud)

如果重要,我安装了以下版本的Java:

java -version
java version "1.7.0_51"
Java(TM) SE Runtime Environment (build 1.7.0_51-b13)
Java HotSpot(TM) 64-Bit Server VM (build 24.51-b03, mixed mode)
Run Code Online (Sandbox Code Playgroud)

更新1

我添加:import …

python java py4j

10
推荐指数
1
解决办法
8086
查看次数

排名之间的距离

我有两种方法可以对字符串列表进行不同的排序,以及我们可以认为是列表的"正确"排名(即黄金标准).

换一种说法:

 ranked_list_of_strings_1 = method_1(list_of_strings)
 ranked_list_of_strings_2 = method_2(list_of_strings)    
 correctly_ranked_list_of_strings # Some permutation of list_of_strings
Run Code Online (Sandbox Code Playgroud)

如何确定哪种方法更好,method_1并且method_2是黑盒子?是否有任何方法来衡量这可无论是在SciPyscikit-learn或类似的库?

在我的具体情况下,我实际上有一个数据框,每个方法输出一个分数.重要的不是在方法和真实分数之间的分数差别,但该方法得到的排名权(分数越高意味着所有列更高的排名).

      strings        scores_method_1   scores_method_2   true_scores
5714  aeSeOg                    0.54               0.1           0.8
5741  NQXACs                    0.15               0.3           0.4
5768  zsFZQi                    0.57               0.7           0.2
Run Code Online (Sandbox Code Playgroud)

python scipy pandas scikit-learn

10
推荐指数
1
解决办法
1585
查看次数

用于数字检索的节省空间的概率数据结构

考虑我们有一个算法,它接收一个假设长的密钥流.然后,当我们处理它时,它为每个键生成一个介于0和1之间的值,用于后验检索.输入集足够大,我们无法为每个键存储一个值.值生成规则在键之间是独立的.

现在,假设我们可以容忍后验查找中的错误,但我们仍希望最小化检索原始值的差异(即渐近地在许多随机检索中).

例如,如果给定键的原始值为0.008,则检索0.06比检索0.6要好得多.

我们可以使用哪些数据结构或算法来解决此问题?

布隆过滤器是我能想到的最接近的数据结构.可以量化输出范围,对每个桶使用布隆过滤器,并以某种方式在检索时将它们的输出组合以估计最可能的值.在我继续这条路径并重新发明轮子之前,是否有任何已知的数据结构,算法,理论或实际方法来解决这个问题?

我理想地寻找一种可以参数化空间和错误率之间权衡的解决方案.

java algorithm probability bloom-filter data-structures

10
推荐指数
1
解决办法
293
查看次数