我在AWS中运行kubernetes cluster,coreos-stable-1745.6.0-hvm(ami-401f5e38),全部由kops 1.9.1/terraform部署。
etcd_version=“3.2.17”
k8s_version=“1.10.2”
此prometheus alertmethod=qget alertname=highnumberoffailedhttprequestsis coming from coreos kube prometheus monitoring bundle.警报从集群生存期的最开始就开始发出,现在已经存在约3周,没有明显的影响。

^ qget失败-33%的请求。
注意:我在其他区域的第二个集群是在相同的版本上从头构建的,它具有完全相同的行为。所以它是可复制的。
任何人都知道什么是根本原因,如果进一步忽略会产生什么影响?
编辑:
后来我发现了这个GH问题,它准确地描述了我的案例:https://github.com/coreos/etcd/issues/9596
这个普罗米修斯警报method=QGET alertname=HighNumberOfFailedHTTPRequests来自科里奥斯库伯普罗米修斯监测包。警报从集群生存期的最开始就开始发出,现在已经存在约3周,没有明显的影响。

^ qget失败-33%的请求。
注意:我在其他区域的第二个集群是在相同的版本上从头构建的,它具有完全相同的行为。所以它是可复制的。
任何人都知道什么是根本原因,如果进一步忽略会产生什么影响?
编辑:
后来我发现了这个GH问题,它准确地描述了我的案例:https://github.com/coreos/etcd/issues/9596