关于 R/ 中的 HIST/hist() 函数,谁能帮我找到:
一个非常简单的定义解释了“breaks”的指定值与直方图中产生的 bin 数量之间的关系?
例如,我使用 R 工具提供的基本数据集:
data(mtcars)
hist(mtcars$mpg, break=3) --> will draw 3 bins (really??? weird!)
hist(mtcars$mpg, break=4) --> will draw 5 bins
hist(mtcars$mpg, break=5) --> will draw 5 bins no change, same as breaks=4
hist(mtcars$mpg, break=6) --> will draw 5 bins no change, same as breaks=4
hist(mtcars$mpg, break=7) --> will draw 5 bins no change, same as breaks=4
hist(mtcars$mpg, break=8) --> will draw 5 bins no change, same as breaks=4
hist(mtcars$mpg, break=9) --> will …Run Code Online (Sandbox Code Playgroud) 我发现一篇文章提供了计算分位数的算法,而 R 显然没有遵循该文章。
文章为: https://www-users.york.ac.uk/~mb55/intro/quantile.htm
在 R 中,我有以下代码:
nv<-c(10,20,30,40)
quantile(nv)
0% 25% 50% 75% 100%
10.0 17.5 25.0 32.5 40.0
Run Code Online (Sandbox Code Playgroud)
然而,75%结果的分位数似乎是错误的,根据文章,公式是:
i = q(n+1)
Run Code Online (Sandbox Code Playgroud)
在我的例子中(75%)q=0.75 且 n=4(我的组合中有 4 个观察值)
X_j + (X_j+1 - X_j) times (i - j)
Run Code Online (Sandbox Code Playgroud)
这意味着它应该是:
30 + (40-30)*(3.75-3) = 37.5而不是32.5
我很难认为 R 犯了一个错误。
我在这里缺少什么?
谢谢。
今天,为了启动 docker-compose.yml 文件中指定/包含的 docker 容器,我首先转到 docker-compose.yml 所在的文件夹,然后输入:
docker-compose up -d
Run Code Online (Sandbox Code Playgroud)
而且效果很好!
如果我希望从不同的文件夹(而不是从 docker-compose.yml 所在的文件夹内部)运行“docker-compose up”命令怎么办:
我试过:
docker-compose up -d -f /data/....../docker-compose.yml
Run Code Online (Sandbox Code Playgroud)
但这不起作用,因为我收到一条警告,确实重新显示了所有可能的选项,并且“-f”不是列出的选项之一。
那么如何指定“docker-compose.yml”的路径作为“docker-compose up”命令的 CLI 参数?
我们需要知道哪种数据库架构更适合使用以及为什么。
我们有一个客户列表,他们都将使用相同的表结构(很少有例外)。
我们将有大约 10,000 个客户,每个客户可能都有大约 50,000 种产品。
每个客户对产品的处理可能不同,我们还希望提供一个计划,让客户可以通过 API 访问他们的数据。
我们的客户确实销售产品,他们的 SQL 表结构都会有如下列:
这 Feed_ID用于区分这些产品的原产地,将是为每个客户独特的-当然。
我们思考过的关系表结构的3种选择:
每个客户都有自己的数据库,在该数据库中,每个产品提要有 1 个表
所有客户都托管在 1 个唯一的数据库下,在该数据库下,所有客户每个提要都有 1 个表 - 在这种情况下,如果他作为 2 个不同的产品提要,则 1 个客户可以有 2 个表。
所有客户都托管在 1 个独特的数据库下,但是,在第三个解决方案中,我们只有 1 个独特的表来托管所有客户的所有产品提要。
您会使用哪种解决方案,为什么您认为您选择的解决方案更好?
谢谢你。