elasticsearch:如何看到警告是在原木/破碎机正在绊倒

ES CentOS上的ES 1.7.x

我们的生产ES集群下了很多。 我们失去了整个指数。 原来,这已经在一天或更长的日志里:

New used memory from field ### would be larger than configured breaker 

好。

ES上的哪些url可以打到,以查看问题正在发生? (日志监控不是我们监控系统的一部分,但是打一个ESurl对我们来说很容易。)

我们现在使用集群健康URL,所以我们看到集群变成黄色/红色,但是(到目前为止),我们还没有看到如何从外部看到问题到来(所以我们得到破坏)。

好的,find了答案。

坦率地说,这是一个非常薄弱的​​回答,给我们处理真正的负担。

如下所示:

https://www.elastic.co/guide/en/elasticsearch/reference/1.4/cluster-nodes-stats.html

用这个:

 curl -XGET 'http://localhost:9200/_nodes/stats?pretty=true' 

然后你可以看到一个断路器元件。

这只是一个计数器,而不是速度。 所以你必须:

  • 编写自己的代码来读取值
  • 等一下
  • 再读一遍
  • 做math
  • 表面断路器跳闸/分钟
  • 找出你的问题门槛是什么
  • 监视这一点

如果ES能够计算出速度,那将会非常好,所以我们可以把重点放在最后两点上。

但从目前我所能看到的情况来看,这是最好的。