values = [8160,8160,6160,22684,0,0,60720,1380,1380,57128]
Run Code Online (Sandbox Code Playgroud)
如何删除0,57218,60720和22684等异常值?
有没有可以做到这一点的图书馆?
我的问题是矩形中有矩形。想想一张地图,除了具有以下特征,关键点是:具有相似密度的矩形通常与其他矩形具有相似的尺寸和在 x 轴上的相似位置,但有时这些矩形之间的距离可能很大但通常很小。如果 x 轴上的位置或尺寸明显偏离,则它们不会相似。
矩形不相交,较小的矩形完全在较大的矩形内。
矩形通常具有相似的 x 位置和相似的尺寸(相似的高度和宽度),并且内部具有较小的矩形。矩形本身将被视为它自己的一个集群。
有时这些集群与另一个集群的距离可能相当大(想想岛屿)。通常这些簇共享相同或相似的维度和相同或相似的子矩形密度。如果是这样,尽管两个集群之间存在距离,但它们应被视为同一集群的一部分。
我附上了一张图表来更清楚地描述情况:

红色边框表示这些组是异常值,不属于任何集群并被忽略。
蓝色边框有许多簇(黑色边框包含黑色实心矩形)。由于上述标准(相似的宽度、相似的 X 位置、相似的密度),它们形成了一组相似的簇。由于标准(相似的宽度、相似的 X 位置、相似的密度),即使是右下角的集群仍然被视为该组的一部分。
绿松石边框有许多簇(黑色边框包含黑色实心矩形)。但是,这些簇在维度、x 位置和密度上与蓝色边框中的簇不同。他们被认为是自己的一个群体。
到目前为止,我发现诸如 DBSCAN 之类的密度聚类似乎是完美的,因为它考虑了噪声(异常值),而且您不需要提前知道会有多少个聚类。
但是,您需要定义形成集群所需的最小点数和阈值距离。如果您不知道这两个并且它可以根据上述问题而变化,会发生什么?
另一个看似合理的解决方案是分层(凝聚)聚类(r-tree),但我担心我仍然需要知道树深度级别的截止点来确定它是否是一个集群。
我发现有时这段代码会返回 NotFoundError: An attempt was made to reference a Node in a context where it does not exist.
$('a').replaceWith(function() {
return $.text([this]);
});
Run Code Online (Sandbox Code Playgroud)
当锚没有任何文本节点时,它是否抱怨一个案例?也许是一个儿童HTML元素?
所以我得到了一个JSON
{key:value, key2:value2, key3:value3...}
Run Code Online (Sandbox Code Playgroud)
我想循环遍历每个条目并获取它的键和值,以便我可以构造这样的东西
{list:[{key:value}, {key2:value2}, {key3:value3}]}
Run Code Online (Sandbox Code Playgroud)
我应该使用下划线吗?