小编Mat*_*ien的帖子

如何用png()保存它中的ggplot大小?

地图尺寸与纬线/长38.31536111,-76.55011111不同于地图lat/long 59.5624775,-139.7410994(地图上的绘图点)

用png()保存它

如何保持相同的尺寸?高度和宽度不够?

编辑:完整的代码

library(maps)
library(ggplot2)
data <- read.csv("data.csv", header=TRUE)
lat = data$lat
long = data$long
world<-map_data('usa')
sf<-data.frame(long=long,lat=lat)
p <- ggplot(height=600, width=800) +
geom_polygon( data=world, aes(x=long, y=lat,group=group)) 
p <- p + geom_point(data=sf,aes(long,lat),colour="white",size=1)
p
Run Code Online (Sandbox Code Playgroud)

数据文件:

"lat","long"
59.5624775,-139.7410994
42.38748056,-94.61803333
Run Code Online (Sandbox Code Playgroud)

如果我删除数据文件中的第一行,则地图大小不同(更大),而不是两条线都存在时

r ggplot2

6
推荐指数
1
解决办法
2万
查看次数

更改 ggplot 中标题的颜色

我已经为此工作了一段时间,但找不到任何合理的解释来解释为什么我的 x 和 y 轴的名称是正确的颜色,而不是标题。

p <- ggplot(movies, aes(x=budget, y=rating))+
  geom_point(shape=1) +
  theme(axis.title.x = element_text(colour = "#7F3D17"),
        axis.title.y = element_text(colour = "#7F3D17"),
        axis.title = element_text(colour = "#7F3D17"),
        panel.background = element_rect(fill='#FFD197'),
        panel.grid.major = element_blank(),
        panel.grid.minor = element_blank(),
        panel.border = element_blank()) +
  labs(x="Budget (in millions)", y="Rating", title="Scatterplot of budget vs movies")
p
Run Code Online (Sandbox Code Playgroud)

散点图看起来像这样(注意标题仍然是黑色的):

在此处输入图片说明

如果有人可以提供帮助,我将不胜感激。

r scatter-plot ggplot2 axis-labels

6
推荐指数
1
解决办法
9373
查看次数

在ggplot中设置中断和标签

我把Shiny应用程序(下面)放在一起,显示了一个等级,除了传说中的科学符号外,它看起来很好.

我希望这些价值观为:'$ 5,000,000','$ 4,000,000'等等.

在此输入图像描述

代码归结为

g <-choroplethr(DF, lod="state", num_buckets = 1)
g <- g + scale_fill_gradient(high = "springgreen4", low= "grey90", name="Sum")
Run Code Online (Sandbox Code Playgroud)

我试过这个:

g <- q + scale_fill_gradient(high = "springgreen4", low= "grey90", name="Sum", labels = c("5,000,000", "4,000,000", "3,000,000", "2,000,000", "1,000,000"))  
Run Code Online (Sandbox Code Playgroud)

但我得到了错误,Breaks和标签是不同的长度

当我处理地图时,我不确定如何在x轴上指定断点?如何创建与我想要包含的标签一起使用的中断?谢谢.

maps r ggplot2 choroplethr

6
推荐指数
1
解决办法
1万
查看次数

在ShinyBS中自定义模态窗口的大小

我最近使用shinyBS来创建一个模态窗口,如

bsModal(id, title, trigger, ..., size)
Run Code Online (Sandbox Code Playgroud)

size参数是'small'或'large'(或不存在).

正如你所看到的,即使是大窗口也很小,而且东西很紧凑:

在此输入图像描述

是否有任何可能的黑客已发现可以帮助自定义窗口的大小?

shiny shinybs

6
推荐指数
1
解决办法
2169
查看次数

查找稀疏 csc_matrix 中存在非零条目的行的索引

我有一个 numpy 数组,X:

type(X)
>>> <class 'scipy.sparse.csc.csc_matrix'>
Run Code Online (Sandbox Code Playgroud)

我有兴趣在第 0 列中找到具有非零条目的行的索引。我试过:

getcol =  X.getcol(0)
print getcol
Run Code Online (Sandbox Code Playgroud)

这给了我:

(0, 0)  1
(2, 0)  1
(5, 0)  10
Run Code Online (Sandbox Code Playgroud)

这很棒,但我想要的是一个包含其中的向量0, 2, 5

我如何获得我正在寻找的索引?

谢谢您的帮助。

python numpy scipy sparse-matrix

5
推荐指数
1
解决办法
1428
查看次数

我可以控制CountVectorizer在scikit中学习语料库的方式吗?

我正在与scikit学习的CountVectorizer一起工作,我可能正在尝试做一些不是为对象制作的东西......但我不确定.

在获取发生次数方面:

vocabulary = ['hi', 'bye', 'run away!']
corpus = ['run away!']
cv = CountVectorizer(vocabulary=vocabulary)
X = cv.fit_transform(corpus)
print X.toarray()
Run Code Online (Sandbox Code Playgroud)

得到:

[[0 0 0 0]]
Run Code Online (Sandbox Code Playgroud)

我所意识到的是,CountVectorizer会将语料库分解为我认为是unigrams:

vocabulary = ['hi', 'bye', 'run']
corpus = ['run away!']
cv = CountVectorizer(vocabulary=vocabulary)
X = cv.fit_transform(corpus)
print X.toarray()
Run Code Online (Sandbox Code Playgroud)

这使:

[[0 0 1]]
Run Code Online (Sandbox Code Playgroud)

有没有办法告诉CountVectorizer你想要如何矢量化语料库?理想情况下,我希望得到第一个例子的结果.

老实说,但是,我想知道是否有可能在这些方面取得成果:

vocabulary = ['hi', 'bye', 'run away!']
corpus = ['I want to run away!']
cv = CountVectorizer(vocabulary=vocabulary)
X = cv.fit_transform(corpus)
print X.toarray()

[[0 0 1]]
Run Code Online (Sandbox Code Playgroud)

我没有在fit_transform方法的文档中看到太多信息,它只接受一个参数.如果有人有任何想法,我将不胜感激.谢谢!

python nlp corpus text-parsing scikit-learn

5
推荐指数
1
解决办法
1662
查看次数

在tidyr中,函数"聚集"使用什么标准来将数据帧从宽到长映射?

我试图找出论据gathertidyr包.

我查看了文档,语法如下:

gather(data, key, value, ..., na.rm = FALSE, convert = FALSE)

帮助文件中有一个示例:

stocks <- data.frame(
  time = as.Date('2009-01-01') + 0:9,
  X = rnorm(10, 0, 1),
  Y = rnorm(10, 0, 2),
  Z = rnorm(10, 0, 4)
)

gather(stocks, stock, price, -time)
Run Code Online (Sandbox Code Playgroud)

我对最后一行感到好奇:
gather(stocks, stock, price, -time)

在这里,stocks显然是我们想要修改的数据,这很好.

所以我可以读取它stock并且price是键值对的参数 - 但是这个函数如何决定如何选择列来创建这个键值对?原始数据框如下所示:

time        X            Y          Z
2009-01-01  1.10177950  -1.1926213  -7.4149618
2009-01-02  0.75578151  -4.3705737  -0.3117843
2009-01-03  -0.23823356 -1.3497319  3.8742654
2009-01-04  0.98744470 …
Run Code Online (Sandbox Code Playgroud)

r dataframe reshape2 tidyr

5
推荐指数
1
解决办法
1886
查看次数

新款ion.RangeSlider为Shiny带来了哪些优势?

截至Shiny 0.11,滑块已更改为ion.RangeSlider.

乍一看,它们看起来非常不同,特别是HTML 5皮肤:

在此输入图像描述

......但显然这些新的滑块可以(很多?)比旧的滑块更多.

我想利用新的ion.RangeSlider,特别是这些功能updateSliderInput,这对我来说不适用于旧的滑块.

但是,我似乎无法找到有关如何真正利用新滑块提供的功能的任何文档.

滑块上的文档看起来与0.11之前的文档相同.

RStudio说新的滑块"支持从服务器更新更多属性......"

我的问题是,支持的属性究竟是什么?

此外,看起来有一些皮肤可以改变滑块的外观 - 使用Shiny时这些皮肤是否可以开箱即用?

例如:

在此输入图像描述

我很想使用这个皮肤 - 突然之间旧滑块和新滑块之间的区别并不那么激烈.

谢谢.

r slider rangeslider shiny

5
推荐指数
1
解决办法
459
查看次数

运行randomForest时出错:找不到对象

所以我想为我的数据集拟合一个随机森林分类器.我是R的新手,我想这是一个简单的格式化问题.

我在一个文本文件中读取并转换我的数据集,因此它具有以下格式:(取出机密信息)

>head(df.train,2)

   GOLGA8A     ITPR3   GPR174  SNORA63    GIMAP8     LEF1    PDE4B LOC100507043    TGFB1I1    SPINT1
Sample1  3.726046 3.4013711 3.794364 4.265287 -1.514573 7.725775 2.162616    -1.514573 -1.5145732 -1.514573
Sample2 4.262779 0.9261892 4.744096 7.276971 -1.514573 4.694769 4.707387     2.031476 -0.8325444  2.615991
...
...
CD8B     FECH    PYCR1 MGC12916     KCNA3 resp
Sample1  -1.514573 2.099336 3.427928 1.542951 -1.514573    1
Sample2 -1.145806 1.204241 2.846832 1.523808  1.616791    1
Run Code Online (Sandbox Code Playgroud)

本质上,列是我的特征,行是我的样本,最后一列是我的响应向量,它是一列因子,resp.

然后我用:

set.seed(1) #Set the seed in order to gain reproducibility

RF1 = randomForest(resp~., data=df.train,ntree=1000,importance=T,mtry=3)
Run Code Online (Sandbox Code Playgroud)

只需尝试resp使用其他列作为功能在我的列上训练RF .

但是我得到了错误:

Error in eval(expr, …
Run Code Online (Sandbox Code Playgroud)

r machine-learning random-forest

5
推荐指数
2
解决办法
1万
查看次数

R 中的传单以不可预测的方式绘制图标

我的 Shiny 应用程序采用这样的数据框:

在此处输入图片说明

并通过允许用户选择一个人 ( P1_name) 和一个日期 ( date)来适当地进行子集。

最初启动时,它看起来像这样:

在此处输入图片说明

很明显,该应用程序无法正常工作。Apple Valley镇的位置应该有一个字母'N',但实际上什么也没有。我不知道为什么,因为 DF 已正确子集化:

在此处输入图片说明

并且图层应该正确绘制:

m <- leaflet(DF) %>%
  addTiles() %>%  # Add default OpenStreetMap map tiles
  setView(lat=setzoom[1], lng=setzoom[2], zoom=zoom_num) %>%
  addMarkers(lat=subset(DF, P1_outcome=='W')$lat, lng=subset(DF, P1_outcome=='W')$lon, icon = icon_W) %>%
  addMarkers(lat=subset(DF, P1_outcome=='L')$lat, lng=subset(DF, P1_outcome=='L')$lon, icon = icon_L) %>%
  addMarkers(lat=subset(DF, P1_outcome=='D')$lat, lng=subset(DF, P1_outcome=='D')$lon, icon = icon_D) %>%
  addMarkers(lat=subset(DF, P1_outcome=='N')$lat, lng=subset(DF, P1_outcome=='N')$lon, icon = icon_N)
Run Code Online (Sandbox Code Playgroud)

不幸的是,这只是我的应用程序显示的某种精神分裂症行为的一种症状。如果这是唯一的问题,我会很高兴。相反,假设我选择了 John Doe,在他的第一行(应该是 Crecent City)

在此处输入图片说明

和 BOOM 我得到:

在此处输入图片说明

如何在世界上没有单张认为我给了它2套坐标,以便进行绘图,什么使它认为李四是drowing在太平洋某处。

这里没有任何意义。我在它输出的混乱中看不到模式。它只有不到 100 行简单的代码。

一些想法:

  • 在 …

r leaflet

4
推荐指数
1
解决办法
1373
查看次数