小编MME*_*MEL的帖子

R Hist:'breaks' 值与 bin 数量/大小之间的关系

关于 R/ 中的 HIST/hist() 函数,谁能帮我找到:

一个非常简单的定义解释了“breaks”的指定值与直方图中产生的 bin 数量之间的关系?

例如,我使用 R 工具提供的基本数据集:

data(mtcars)
hist(mtcars$mpg, break=3) --> will draw 3 bins (really??? weird!)
hist(mtcars$mpg, break=4) --> will draw 5 bins 
hist(mtcars$mpg, break=5) --> will draw 5 bins no change, same as breaks=4
hist(mtcars$mpg, break=6) --> will draw 5 bins no change, same as breaks=4
hist(mtcars$mpg, break=7) --> will draw 5 bins no change, same as breaks=4
hist(mtcars$mpg, break=8) --> will draw 5 bins no change, same as breaks=4
hist(mtcars$mpg, break=9) --> will …
Run Code Online (Sandbox Code Playgroud)

r histogram

4
推荐指数
1
解决办法
1261
查看次数

R计算分位数错误或不同?

我发现一篇文章提供了计算分位数的算法,而 R 显然没有遵循该文章。

文章为: https://www-users.york.ac.uk/~mb55/intro/quantile.htm

在 R 中,我有以下代码:

nv<-c(10,20,30,40)
quantile(nv)
  0%  25%  50%  75% 100% 
10.0 17.5 25.0 32.5 40.0
Run Code Online (Sandbox Code Playgroud)

然而,75%结果的分位数似乎是错误的,根据文章,公式是:

i = q(n+1) 
Run Code Online (Sandbox Code Playgroud)

在我的例子中(75%)q=0.75 且 n=4(我的组合中有 4 个观察值)

X_j + (X_j+1 - X_j) times (i - j) 
Run Code Online (Sandbox Code Playgroud)

这意味着它应该是:

30 + (40-30)*(3.75-3) = 37.5而不是32.5

我很难认为 R 犯了一个错误。

我在这里缺少什么?

谢谢。

r quantile

3
推荐指数
1
解决办法
2188
查看次数

“docker-compose.yml”的路径作为参数

今天,为了启动 docker-compose.yml 文件中指定/包含的 docker 容器,我首先转到 docker-compose.yml 所在的文件夹,然后输入:

docker-compose up -d
Run Code Online (Sandbox Code Playgroud)

而且效果很好!

如果我希望从不同的文件夹(而不是从 docker-compose.yml 所在的文件夹内部)运行“docker-compose up”命令怎么办:

我试过:

docker-compose up -d -f /data/....../docker-compose.yml
Run Code Online (Sandbox Code Playgroud)

但这不起作用,因为我收到一条警告,确实重新显示了所有可能的选项,并且“-f”不是列出的选项之一。

那么如何指定“docker-compose.yml”的路径作为“docker-compose up”命令的 CLI 参数?

docker docker-compose

3
推荐指数
1
解决办法
3434
查看次数

数据库架构问题:每个客户 1 个表或所有客户的 1 个唯一表

我们需要知道哪种数据库架构更适合使用以及为什么。

我们有一个客户列表,他们都将使用相同的表结构(很少有例外)。

我们将有大约 10,000 个客户,每个客户可能都有大约 50,000 种产品。

每个客户对产品的处理可能不同,我们还希望提供一个计划,让客户可以通过 API 访问他们的数据。

我们的客户确实销售产品,他们的 SQL 表结构都会有如下列:

  • Feed_ID
  • 产品编号
  • 产品描述
  • 价钱
  • 重量
  • 等等...

这 Feed_ID用于区分这些产品的原产地,将是为每个客户独特的-当然。

我们思考过的关系表结构的3种选择:

  1. 每个客户都有自己的数据库,在该数据库中,每个产品提要有 1 个表

  2. 所有客户都托管在 1 个唯一的数据库下,在该数据库下,所有客户每个提要都有 1 个表 - 在这种情况下,如果他作为 2 个不同的产品提要,则 1 个客户可以有 2 个表。

  3. 所有客户都托管在 1 个独特的数据库下,但是,在第三个解决方案中,我们只有 1 个独特的表来托管所有客户的所有产品提要。

您会使用哪种解决方案,为什么您认为您选择的解决方案更好?

谢谢你。

sql database-design product

2
推荐指数
1
解决办法
902
查看次数