地图尺寸与纬线/长38.31536111,-76.55011111不同于地图lat/long 59.5624775,-139.7410994(地图上的绘图点)
用png()保存它
如何保持相同的尺寸?高度和宽度不够?
编辑:完整的代码
library(maps)
library(ggplot2)
data <- read.csv("data.csv", header=TRUE)
lat = data$lat
long = data$long
world<-map_data('usa')
sf<-data.frame(long=long,lat=lat)
p <- ggplot(height=600, width=800) +
geom_polygon( data=world, aes(x=long, y=lat,group=group))
p <- p + geom_point(data=sf,aes(long,lat),colour="white",size=1)
p
Run Code Online (Sandbox Code Playgroud)
数据文件:
"lat","long"
59.5624775,-139.7410994
42.38748056,-94.61803333
Run Code Online (Sandbox Code Playgroud)
如果我删除数据文件中的第一行,则地图大小不同(更大),而不是两条线都存在时
我已经为此工作了一段时间,但找不到任何合理的解释来解释为什么我的 x 和 y 轴的名称是正确的颜色,而不是标题。
p <- ggplot(movies, aes(x=budget, y=rating))+
geom_point(shape=1) +
theme(axis.title.x = element_text(colour = "#7F3D17"),
axis.title.y = element_text(colour = "#7F3D17"),
axis.title = element_text(colour = "#7F3D17"),
panel.background = element_rect(fill='#FFD197'),
panel.grid.major = element_blank(),
panel.grid.minor = element_blank(),
panel.border = element_blank()) +
labs(x="Budget (in millions)", y="Rating", title="Scatterplot of budget vs movies")
p
Run Code Online (Sandbox Code Playgroud)
散点图看起来像这样(注意标题仍然是黑色的):

如果有人可以提供帮助,我将不胜感激。
我把Shiny应用程序(下面)放在一起,显示了一个等级,除了传说中的科学符号外,它看起来很好.
我希望这些价值观为:'$ 5,000,000','$ 4,000,000'等等.

代码归结为
g <-choroplethr(DF, lod="state", num_buckets = 1)
g <- g + scale_fill_gradient(high = "springgreen4", low= "grey90", name="Sum")
Run Code Online (Sandbox Code Playgroud)
我试过这个:
g <- q + scale_fill_gradient(high = "springgreen4", low= "grey90", name="Sum", labels = c("5,000,000", "4,000,000", "3,000,000", "2,000,000", "1,000,000"))
Run Code Online (Sandbox Code Playgroud)
但我得到了错误,Breaks和标签是不同的长度
当我处理地图时,我不确定如何在x轴上指定断点?如何创建与我想要包含的标签一起使用的中断?谢谢.
我最近使用shinyBS来创建一个模态窗口,如
bsModal(id, title, trigger, ..., size)
Run Code Online (Sandbox Code Playgroud)
size参数是'small'或'large'(或不存在).
正如你所看到的,即使是大窗口也很小,而且东西很紧凑:
是否有任何可能的黑客已发现可以帮助自定义窗口的大小?
我有一个 numpy 数组,X:
type(X)
>>> <class 'scipy.sparse.csc.csc_matrix'>
Run Code Online (Sandbox Code Playgroud)
我有兴趣在第 0 列中找到具有非零条目的行的索引。我试过:
getcol = X.getcol(0)
print getcol
Run Code Online (Sandbox Code Playgroud)
这给了我:
(0, 0) 1
(2, 0) 1
(5, 0) 10
Run Code Online (Sandbox Code Playgroud)
这很棒,但我想要的是一个包含其中的向量0, 2, 5。
我如何获得我正在寻找的索引?
谢谢您的帮助。
我正在与scikit学习的CountVectorizer一起工作,我可能正在尝试做一些不是为对象制作的东西......但我不确定.
在获取发生次数方面:
vocabulary = ['hi', 'bye', 'run away!']
corpus = ['run away!']
cv = CountVectorizer(vocabulary=vocabulary)
X = cv.fit_transform(corpus)
print X.toarray()
Run Code Online (Sandbox Code Playgroud)
得到:
[[0 0 0 0]]
Run Code Online (Sandbox Code Playgroud)
我所意识到的是,CountVectorizer会将语料库分解为我认为是unigrams:
vocabulary = ['hi', 'bye', 'run']
corpus = ['run away!']
cv = CountVectorizer(vocabulary=vocabulary)
X = cv.fit_transform(corpus)
print X.toarray()
Run Code Online (Sandbox Code Playgroud)
这使:
[[0 0 1]]
Run Code Online (Sandbox Code Playgroud)
有没有办法告诉CountVectorizer你想要如何矢量化语料库?理想情况下,我希望得到第一个例子的结果.
老实说,但是,我想知道是否有可能在这些方面取得成果:
vocabulary = ['hi', 'bye', 'run away!']
corpus = ['I want to run away!']
cv = CountVectorizer(vocabulary=vocabulary)
X = cv.fit_transform(corpus)
print X.toarray()
[[0 0 1]]
Run Code Online (Sandbox Code Playgroud)
我没有在fit_transform方法的文档中看到太多信息,它只接受一个参数.如果有人有任何想法,我将不胜感激.谢谢!
我试图找出论据gather的tidyr包.
我查看了文档,语法如下:
gather(data, key, value, ..., na.rm = FALSE, convert = FALSE)
帮助文件中有一个示例:
stocks <- data.frame(
time = as.Date('2009-01-01') + 0:9,
X = rnorm(10, 0, 1),
Y = rnorm(10, 0, 2),
Z = rnorm(10, 0, 4)
)
gather(stocks, stock, price, -time)
Run Code Online (Sandbox Code Playgroud)
我对最后一行感到好奇:
gather(stocks, stock, price, -time)
在这里,stocks显然是我们想要修改的数据,这很好.
所以我可以读取它stock并且price是键值对的参数 - 但是这个函数如何决定如何选择列来创建这个键值对?原始数据框如下所示:
time X Y Z
2009-01-01 1.10177950 -1.1926213 -7.4149618
2009-01-02 0.75578151 -4.3705737 -0.3117843
2009-01-03 -0.23823356 -1.3497319 3.8742654
2009-01-04 0.98744470 …Run Code Online (Sandbox Code Playgroud) 截至Shiny 0.11,滑块已更改为ion.RangeSlider.
乍一看,它们看起来非常不同,特别是HTML 5皮肤:

......但显然这些新的滑块可以(很多?)比旧的滑块更多.
我想利用新的ion.RangeSlider,特别是这些功能updateSliderInput,这对我来说不适用于旧的滑块.
但是,我似乎无法找到有关如何真正利用新滑块提供的功能的任何文档.
滑块上的文档看起来与0.11之前的文档相同.
RStudio说新的滑块"支持从服务器更新更多属性......"
我的问题是,支持的属性究竟是什么?
此外,看起来有一些皮肤可以改变滑块的外观 - 使用Shiny时这些皮肤是否可以开箱即用?
例如:

我很想使用这个皮肤 - 突然之间旧滑块和新滑块之间的区别并不那么激烈.
谢谢.
所以我想为我的数据集拟合一个随机森林分类器.我是R的新手,我想这是一个简单的格式化问题.
我在一个文本文件中读取并转换我的数据集,因此它具有以下格式:(取出机密信息)
>head(df.train,2)
GOLGA8A ITPR3 GPR174 SNORA63 GIMAP8 LEF1 PDE4B LOC100507043 TGFB1I1 SPINT1
Sample1 3.726046 3.4013711 3.794364 4.265287 -1.514573 7.725775 2.162616 -1.514573 -1.5145732 -1.514573
Sample2 4.262779 0.9261892 4.744096 7.276971 -1.514573 4.694769 4.707387 2.031476 -0.8325444 2.615991
...
...
CD8B FECH PYCR1 MGC12916 KCNA3 resp
Sample1 -1.514573 2.099336 3.427928 1.542951 -1.514573 1
Sample2 -1.145806 1.204241 2.846832 1.523808 1.616791 1
Run Code Online (Sandbox Code Playgroud)
本质上,列是我的特征,行是我的样本,最后一列是我的响应向量,它是一列因子,resp.
然后我用:
set.seed(1) #Set the seed in order to gain reproducibility
RF1 = randomForest(resp~., data=df.train,ntree=1000,importance=T,mtry=3)
Run Code Online (Sandbox Code Playgroud)
只需尝试resp使用其他列作为功能在我的列上训练RF .
但是我得到了错误:
Error in eval(expr, …Run Code Online (Sandbox Code Playgroud) 我的 Shiny 应用程序采用这样的数据框:
并通过允许用户选择一个人 ( P1_name) 和一个日期 ( date)来适当地进行子集。
最初启动时,它看起来像这样:
很明显,该应用程序无法正常工作。Apple Valley镇的位置应该有一个字母'N',但实际上什么也没有。我不知道为什么,因为 DF 已正确子集化:
并且图层应该正确绘制:
m <- leaflet(DF) %>%
addTiles() %>% # Add default OpenStreetMap map tiles
setView(lat=setzoom[1], lng=setzoom[2], zoom=zoom_num) %>%
addMarkers(lat=subset(DF, P1_outcome=='W')$lat, lng=subset(DF, P1_outcome=='W')$lon, icon = icon_W) %>%
addMarkers(lat=subset(DF, P1_outcome=='L')$lat, lng=subset(DF, P1_outcome=='L')$lon, icon = icon_L) %>%
addMarkers(lat=subset(DF, P1_outcome=='D')$lat, lng=subset(DF, P1_outcome=='D')$lon, icon = icon_D) %>%
addMarkers(lat=subset(DF, P1_outcome=='N')$lat, lng=subset(DF, P1_outcome=='N')$lon, icon = icon_N)
Run Code Online (Sandbox Code Playgroud)
不幸的是,这只是我的应用程序显示的某种精神分裂症行为的一种症状。如果这是唯一的问题,我会很高兴。相反,假设我选择了 John Doe,在他的第一行(应该是 Crecent City)
和 BOOM 我得到:
如何在世界上没有单张认为我给了它2套坐标,以便进行绘图,什么使它认为李四是drowing在太平洋某处。
这里没有任何意义。我在它输出的混乱中看不到模式。它只有不到 100 行简单的代码。
一些想法:
r ×7
ggplot2 ×3
python ×2
shiny ×2
axis-labels ×1
choroplethr ×1
corpus ×1
dataframe ×1
leaflet ×1
maps ×1
nlp ×1
numpy ×1
rangeslider ×1
reshape2 ×1
scatter-plot ×1
scikit-learn ×1
scipy ×1
shinybs ×1
slider ×1
text-parsing ×1
tidyr ×1