各位,
我正在尝试在 python 中使用 ggplot。
from ggplot import *
ggplot(diamonds, aes(x='price', fill='cut')) + geom_density(alpha=0.25) + facet_wrap("clarity")
Run Code Online (Sandbox Code Playgroud)
我正在尝试做的几件事:
1)我希望颜色既填充又线条,但正如你所看到的颜色都是灰色的
2)我正在尝试调整绘图的大小。在 RI 中,会在情节之前运行:
options(repr.plot.width=12, repr.plot.height=4)
Run Code Online (Sandbox Code Playgroud)
但是,这在这里不起作用。
有谁知道我如何在分布中着色并改变绘图大小?
谢谢你。附上电流输出。
此链接具有R代码以复制ggplot的颜色:使用qplot绘制函数系列而不复制数据
我已经去过复制python中的代码 - 但结果不对...
import pandas as pd
import numpy as np
import matplotlib.pyplot as plt
import math
import colorsys
# function to return a list of hex colour strings
def colorMaker(n=12, start=15.0/360.0, saturation=1.0, valight=0.65) :
listOfColours = []
for i in range(n) :
hue = math.modf(float(i)/float(n) + start)[0]
#(r,g,b) = colorsys.hsv_to_rgb(hue, saturation, valight)
(r,g,b) = colorsys.hls_to_rgb(hue, valight, saturation)
listOfColours.append( '#%02x%02x%02x' % (int(r*255), int(g*255), int(b*255)) )
return listOfColours
# made up data
x = np.array(range(20))
d = {}
d['y1'] …Run Code Online (Sandbox Code Playgroud) 我需要在python ggplot上绘制3列Pandas数据帧,并使用相同的索引.那可能吗?
谢谢
我在 python 中使用 ggplot,只是想制作一个基本的条形图。由于我不明白的原因,条形高度对应于变量名称的计数,而不是实际变量。
简单的例子
pattern = pd.Series(['standard', 'woolly', 'brown', 'spotted', 'red', 'wheat', 'grey'], dtype = 'category')
population = pd.Series([12, 2, 7, 3, 2, 4,5])
patternCount = pd.DataFrame({'color':pattern, 'population':population})
ggplot(aes(x = 'attribute', y = 'population'), data = animalCounts) +\
geom_bar(stat = "identity")
Run Code Online (Sandbox Code Playgroud)
我知道这些是计数,而不仅仅是数字,因为如果我有这些名称中的任何一个重复,该变量将显示为“2”。
我想我在这里犯了一些非常简单的错误。谢谢你的帮助。
编辑:根据罗恩诺里斯的要求,这里是相同的数字,但缩放到 12,而不是 1。
新年快乐,
我试图在我的ubuntu 14.04上安装ggplot并得到以下错误消息(代码)
我的python-dev 2.7.5-5ubuntu3.
我已经做了以下事情
sudo apt-get update
sudo apt-get upgrade gcc sudo apt-get install python2.7-dev
william@ubuntu:~$ sudo pip install ggplot
[sudo] password for william:
Downloading/unpacking ggplot
Downloading ggplot-0.6.5.tar.gz (8.4MB): 8.4MB downloaded
Running setup.py (path:/tmp/pip_build_root/ggplot/setup.py) egg_info for package ggplot
Requirement already satisfied (use --upgrade to upgrade): six in /usr/lib/python3/dist-packages (from ggplot)
Downloading/unpacking statsmodels (from ggplot)
Downloading statsmodels-0.6.1.tar.gz (7.0MB): 7.0MB downloaded
Running setup.py (path:/tmp/pip_build_root/statsmodels/setup.py) egg_info for package statsmodels
/bin/sh: 1: svnversion: not found
/bin/sh: 1: svnversion: not found
_configtest.c:1:5: warning: …Run Code Online (Sandbox Code Playgroud)我正在进行聚类,并尝试绘制结果。虚拟数据集为:
数据
import numpy as np
X = np.random.randn(10)
Y = np.random.randn(10)
Cluster = np.array([0, 1, 1, 1, 3, 2, 2, 3, 0, 2]) # Labels of cluster 0 to 3
Run Code Online (Sandbox Code Playgroud)
集群中心
centers = np.random.randn(4, 2) # 4 centers, each center is a 2D point
Run Code Online (Sandbox Code Playgroud)
我想作一个散点图,以data根据聚类标签显示点并为点着色。
然后,我想将center点分散在同一散点图上,以另一种形状(例如“ X”)和第五种颜色(因为有4个簇)叠加。
color和cmap中感到困惑,所以我想知道是否可以使用seaborn或ggplot来做到这一点。如何将其拟合为非线性曲线?
def plot(version, str_metric):
metric1 = [0.459, 0.5844, 0.6246, 0.6459, 0.6429, 0.6629, 0.664, 0.6722, 0.6832, 0.6931, 0.7103, 0.7144, 0.7213, 0.716, 0.7182, 0.7419, 0.7418, 0.7594, 0.7639, 0.7854, 0.7752, 0.7912, 0.8164, 0.8311,
0.8283, 0.8103, 0.869, 0.8708, 0.884, 0.9017, 0.9248, 0.9233, 0.9432, 0.9306, 0.945, 0.959, 0.9675, 0.9649, 0.982, 0.9276, 0.975, 0.9772, 0.9786, 0.988, 0.9825, 0.9901, 0.9934, 0.993, 0.9956, 0.9951]
metric2 = [0.4541, 0.5807, 0.6138, 0.6339, 0.6322, 0.63, 0.6451, 0.6514, 0.6589, 0.6597, 0.6759, 0.6817, 0.6866, 0.6803, 0.6819, 0.7009, 0.7039, 0.7162, 0.7197, 0.7237, …Run Code Online (Sandbox Code Playgroud) 我从www.nasdaq.com下载了TESLA股票;下载CSV文件后,我意识到我需要使用Microsoft Excel 2016转换CSV。然后单击“文本到列”。标头现在很清楚,它们是:日期,收盘价,成交量,开盘价,最高价,最低价。请在此处查看csv文件。LinK:https://drive.google.com/open ? id = 1cirQi47U4uumvA14g6vOmgsXbV-YvS4l
Preview (The CSV data is from 02/02/2017 until 02/02/2018):
1. date | close | volume | open | high | low |
2. 02/02/2018 | 343.75 | 3696157 | 348.44 | 351.95 | 340.51|
3. 01/02/2018 | 349.25 | 4187440 | 351.00 | 359.66 | 348.63|
Run Code Online (Sandbox Code Playgroud)
我面临的挑战是创建每个月的数据指针,并使其尽可能接近每月的第一天。我过滤了excel文件,这就是我得到的数据。
- date | close
- 01/02/2018 | 349.25
- 02/01/2018 | 320.53
- 01/12/2017 | 306.53
- 01/11/2017 | 321.08
- 02/10/2017 | 341.53 …Run Code Online (Sandbox Code Playgroud) python ×8
ggplot2 ×2
matplotlib ×2
pandas ×2
csv ×1
exponential ×1
forecasting ×1
plot ×1
plotnine ×1
python-3.x ×1
seaborn ×1