我已经开始将R用法集成到Notebook中,从我的角度来看,两者都是最好的(python中的数据管理,同时利用R的比较分析/图形优势).不幸的是,我挂了一个看似简单的元素,调整ggplot2图形的绘图大小.使用pandas调整绘图大小非常简单,在纯R环境(如RStudio)中,我可以使用dev.new()或PNG()等调整绘图.但是,尝试这样做是因为笔记本让我的计算机变得疯狂(我在华硕U46E上运行Ubuntu 13.04).此外,这是至关重要的,我想保持图形内联,以便我可以将脚本完整地传递给我的同事.
尝试dev.new()时,我的计算机已锁定,我不得不切换到另一个虚拟终端重启.我试图调整x11()选项,我的浏览器暂时没有响应,而图形有点乱.最终,我再次被授予控制权,但我不知道为什么会这样.
有谁知道为什么会发生这种情况?另外,有没有人知道如何调整从IPython Notebook中渲染的ggplot2对象的绘图大小?我恐怕无法分享数据,但我可以告诉你,我试图绘制基金中心(分类变量)所面对的三个数字变量.这些图确实按照书面执行...直到我试图调整大小.这是我的示例代码:
%%R
#x11(width=500,height=300) << didn't work
#dev.new() << tried before setting size parameters, and it locked up my laptop
#Plot total expenses by unit
print('*****Expenses by Unit*****')
print(smu)
print(ggplot(smu,aes(x=fy,y=as.numeric(as.character(totexp)),group=fund,colour=fund))+geom_line(size=2)+
ggtitle('Total Expenses'))
#Plot expense components
print(ggplot(smu,aes(fy))+
geom_line(aes(y=as.numeric(as.character(fixed)),colour='fixed',group=fund,colour=fund))+
geom_line(aes(y=as.numeric(as.character(var)),colour='variable',group=fund,colour=fund))+
geom_bar(aes(y=as.numeric(as.character(incadj)),group=1),stat='identity')+
facet_grid(.~fund)+
ggtitle('Components of Expenditure'))
Run Code Online (Sandbox Code Playgroud) 我对IPython Notebook印象非常深刻,我想更广泛地使用它.我的问题与安全数据有关.我对网络知之甚少.如果我使用IPython Notebook,那么通过Web发送到远程服务器的数据是什么?还是全部包含在本地?我不是在谈论为多个接入点设置公共资源,只是使用我的机器上的数据,就像我使用SAS或R.
谢谢
有很多问题,ClassNotFoundException但我还没有看到任何(还)适合这种特定情况的问题。我正在尝试运行以下命令:
spark-submit --master local[*] --class com.stronghold.HelloWorld scala-ts.jar
它抛出以下异常:
\u@\h:\w$ spark_submit --class com.stronghold.HelloWorld scala-ts.jar ? 9.8.0 [±master ???]
2018-05-06 19:52:33 WARN Utils:66 - Your hostname, asusTax resolves to a loopback address: 127.0.1.1; using 192.168.1.184 instead (on interface p1p1)
2018-05-06 19:52:33 WARN Utils:66 - Set SPARK_LOCAL_IP if you need to bind to another address
2018-05-06 19:52:33 WARN NativeCodeLoader:62 - Unable to load native-hadoop library for your platform... using builtin-java classes where applicable
java.lang.ClassNotFoundException: com.stronghold.HelloWorld
at java.net.URLClassLoader.findClass(URLClassLoader.java:381)
at java.lang.ClassLoader.loadClass(ClassLoader.java:424)
at java.lang.ClassLoader.loadClass(ClassLoader.java:357) …Run Code Online (Sandbox Code Playgroud) 我正在运行一项分析,该分析可能会受益于 BEA 区域的聚类。我以前没有在 Statsmodels 中使用过集群标准错误选项,所以我不清楚我是否搞乱了语法,或者该选项已损坏。任何帮助将不胜感激。
这是相关的代码部分(请注意,该topline_specs字典返回 Patsy 风格的公式):
#Capture topline specs
topline_specs={'GO':spec_dict['PC_GO']['Total']['TYPE']['BOTH'],
'RV':spec_dict['PC_RV']['Total']['TYPE']['BOTH'],
'ISSUER':spec_dict['PROP']['ISSUER']['TYPE']['BOTH'],
'PURPOSE':spec_dict['PROP']['PURPOSE']['TYPE']['BOTH']}
#Estimate each model
topline_mods={'GO':smf.ols(formula=topline_specs['GO'],data=data_d).fit(cov_type='cluster',
cov_kwds={'groups':data_d['BEA_INT']})}
topline_mods['GO']
Run Code Online (Sandbox Code Playgroud)
回溯源于 numpy 调用。它返回以下内容:
ValueError: The weights and list don't have the same length.
Run Code Online (Sandbox Code Playgroud)
我能找到的关于使用集群标准错误的所有内容看起来都像是cov_kwds参数可以从容纳模型数据的 DataFrame 中获取一个 Series。我缺少什么?
在处理我们的一些数据时,我必须执行非常基本的列条件组合。填充空值后,尝试在分配新变量的列中添加。其中一列最终成为对象,这并非史无前例。然而,我发现看似有效的值不会转换为浮点数(例如 4,789.67)。经过多次搜索,似乎我所看到的每个解决方案都指向存在不规则字符(它没有描述我的情况)。因此,我尝试在 IPython 中进行实验以重现错误,并且我成功了。但是,我不明白为什么会出现此错误:
测试
z='4,534.07' #initial assignment
print z
print type(z) #checked type
print repr(z) #tried to reveal hidden characters
print repr(z.replace("'","")) #tried to remove excess quotes
print z[1:-1] #tried again to remove excess quotes
print float(z) #failed conversion attempt
Run Code Online (Sandbox Code Playgroud)
输出
4,534.07
<type 'str'>
'4,534.07'
'4,534.07'
,534.0
---------------------------------------------------------------------------
ValueError Traceback (most recent call last)
<ipython-input-70-8a3c46ebe6ab> in <module>()
6 print z[1:-1]
7 print z
----> 8 print float(z)
ValueError: invalid literal for float(): 4,534.07
Run Code Online (Sandbox Code Playgroud)
我看到的基本转换问题的解决方案总是建议以下将“x”转换为 float -->> float(x)。如果有人能解释我遗漏了什么,我将不胜感激。(我以前没有发生过这种情况。)
我一直在使用Enthought平台:
发行说明 …
我对 Fortran 有点陌生,是从 Python、R 和 SAS 开始接触它的。在所有这些语言中,数据类型格式化都嵌入在输出函数中,但 Fortran 需要(除其他外)为每个写入的变量提供显式格式指示符。我想通过利用变量自省来动态构建格式字符串,让 fortran 告诉我数据类型是什么,以及适用的属性(KIND、LEN 等)。这种反思也将有助于构建普遍适用的程序子单元。
在 Python 和 R 的 OO 世界中,这是一个微不足道的查询。例如,在 Python 中测试一个值是否是字符串只是......
isinstance('foo',basestring)
Run Code Online (Sandbox Code Playgroud)
当然还有其他方法。无论如何,我无法动摇这种内在的探究必须存在于 Fortran 中的想法。迄今为止,我所看到的都是无法区分整个实数值和整数的方法。
其他人建议IOSTAT在READ声明中使用该参数。我还没有弄清楚如何利用这个语句来处理内存中已经存在的变量。(目前,我只遇到过将该READ语句与从键盘或硬盘上的文件读取结合使用。)
有人请告诉我我在某个地方犯了严重的疏忽。我觉得这个能力必须存在。谢谢。
python ×2
apache-spark ×1
fortran ×1
ggplot2 ×1
ipython ×1
java ×1
r ×1
scala ×1
security ×1
statsmodels ×1