prometheus配置告警規(guī)則和釘釘告警

一劣砍、配置告警規(guī)則

1、配置rule告警規(guī)則存放路徑

$ vim prometheus-configmap.yaml
增加如下配置:
    rule_files:
    - /etc/config/rules/*.rules

如下圖:


image.png

2香嗓、再次更新prometheus-configmap.yaml 靠娱,使其生效像云。

$ kubectl apply -f prometheus-configmap.yaml 
configmap/prometheus-config configured

3、編寫告警rules
這里我們直接編輯幾個常規(guī)告警rules用于測試(prometheus-rules.yaml)

apiVersion: v1
kind: ConfigMap
metadata:
  name: prometheus-rules
  namespace: kube-system
data:
  general.rules: |
    groups:
    - name: general.rules
      rules:
      - alert: InstanceDown
        expr: up == 0
        for: 2m
        labels:
          severity: error
        annotations:
          summary: "Instance {{ $labels.instance }} 停止工作"
          description: "{{ $labels.instance }}: job {{ $labels.job }} 已經(jīng)停止5分鐘以上."
  node.rules: |
    groups:
    - name: node.rules
      rules:
      - alert: NodeFilesystemUsage
        expr: 100 - (node_filesystem_free_bytes{fstype=~"ext4|xfs"} / node_filesystem_size_bytes{fstype=~"ext4|xfs"} * 100) > 1
        for: 2m
        labels:
          severity: warning
        annotations:
          summary: "{{$labels.instance}}: {{$labels.mountpoint }} 分區(qū)使用過高"
          description: "{{$labels.instance}}: {{$labels.mountpoint }} 分區(qū)使用大于 1% (當(dāng)前值: {{ $value }})"
      - alert: NodeMemoryUsage
        expr: 100 - (node_memory_MemFree_bytes+node_memory_Cached_bytes+node_memory_Buffers_bytes) / node_memory_MemTotal_bytes * 100 > 80
        for: 2m
        labels:
          severity: warning
        annotations:
          summary: "{{$labels.instance}}: 內(nèi)存使用過高"
          description: "{{$labels.instance}}: 內(nèi)存使用大于 80% (當(dāng)前值: {{ $value }})"
      - alert: NodeCPUUsage
        expr: 100 - (avg(irate(node_cpu_seconds_total{mode="idle"}[5m])) by (instance) * 100) > 80
        for: 2m
        labels:
          severity: warning
        annotations:
          summary: "{{$labels.instance}}: CPU使用過高"
          description: "{{$labels.instance}}: CPU使用大于 80% (當(dāng)前值: {{ $value }})"

4、應(yīng)用 prometheus-rules.yaml

$ kubectl apply -f prometheus-rules.yaml 
configmap/prometheus-rules created

5惩歉、將configmap掛載到容器rules目錄撑蚌,修改prometheus-statefulset.yaml搏屑,增加下圖中紅框內(nèi)容辣恋。

$ vim prometheus-statefulset.yaml
      volumeMounts:
        - name: config-volume
          mountPath: /etc/config
        - name: prometheus-data
          mountPath: /data
          subPath: ""
        - name: prometheus-rules
          mountPath: /etc/config/rules

      terminationGracePeriodSeconds: 300
      volumes:
        - name: config-volume
          configMap:
            name: prometheus-config
        - name: prometheus-rules
          configMap:
            name: prometheus-rules

image.png

注意:這里的configMap名字對應(yīng)剛剛prometheus-rules創(chuàng)建的configmap名字

6包警、重新應(yīng)用prometheus-statefulset.yaml

$ kubectl apply -f prometheus-statefulset.yaml
NAME                                         READY   STATUS    RESTARTS   AGE
alertmanager-6b5bbd5bd4-g9mpd                2/2     Running   0          66m
coredns-55f46dd959-9kspv                     1/1     Running   3          35d
coredns-55f46dd959-l5vww                     1/1     Running   0          35d
grafana-0                                    1/1     Running   0          2d
kube-state-metrics-6cf969f79b-29f2r          1/1     Running   0          5d23h
kubernetes-dashboard-ccd98cd4c-jzlbs         1/1     Running   0          34d
node-exporter-7x9zl                          1/1     Running   0          18h
node-exporter-ksslf                          1/1     Running   0          18h
prometheus-0                                 2/2     Running   0          30m

7害晦、查看prometheus rules規(guī)則已顯示生效


image.png

二壹瘟、配置釘釘告警

1稻轨、注冊釘釘賬號->機(jī)器人管理->自定義(通過webhook接入自定義服務(wù))->添加->復(fù)制webhook

image.png

上述配置好群機(jī)器人殴俱,獲得這個機(jī)器人對應(yīng)的Webhook地址线欲,記錄下來李丰,后續(xù)配置釘釘告警插件要用逼泣,格式如下
https://oapi.dingtalk.com/robot/send?access_token=xxxxxxxx
2舟舒、創(chuàng)建釘釘告警插件(dingtalk-webhook.yaml)秃励,并修改文件中 access_token=xxxxxx 為上一步你獲得的機(jī)器人認(rèn)證 token

$ vim dingtalk-webhook.yaml
---
apiVersion: extensions/v1beta1
kind: Deployment
metadata:
  labels:
    run: dingtalk
  name: webhook-dingtalk
  namespace: monitoring
spec:
  replicas: 1
  template:
    metadata:
      labels:
        run: dingtalk
    spec:
      containers:
      - name: dingtalk
        image: timonwong/prometheus-webhook-dingtalk:v0.3.0
        imagePullPolicy: IfNotPresent
        # 設(shè)置釘釘群聊自定義機(jī)器人后莺治,使用實(shí)際 access_token 替換下面 xxxxxx部分
        args:
          - --ding.profile=webhook1=https://oapi.dingtalk.com/robot/send?access_token=94c9f3664df1a928cb59550ac88caf504ca1808a22e7018fdcf92c50d9960fab
        ports:
        - containerPort: 8060
          protocol: TCP

---
apiVersion: v1
kind: Service
metadata:
  labels:
    run: dingtalk
  name: webhook-dingtalk
  namespace: monitoring
spec:
  ports:
  - port: 8060
    protocol: TCP
    targetPort: 8060
  selector:
    run: dingtalk
  sessionAffinity: None

3、應(yīng)用dingtalk-webhook.yaml

$ kubectl apply -f dingtalk-webhook.yaml

4滋早、修改 alertsmanager 告警配置后砌们,更新alertmanager-configmap.yaml 部署,成功后測試告警發(fā)送

$ vim alertmanager-configmap.yaml 
apiVersion: v1
kind: ConfigMap
metadata:
  name: alertmanager-config
  namespace: kube-system
  labels:
    kubernetes.io/cluster-service: "true"
    addonmanager.kubernetes.io/mode: EnsureExists
data:
  alertmanager.yml: |
    global: null
    receivers:
    - name: default-receiver
    route:
      group_interval: 5m
      group_wait: 10s
      receiver: dingtalk
      repeat_interval: 10m

    receivers:
    - name: dingtalk
      webhook_configs:
      - send_resolved: true
        url: http://webhook-dingtalk.monitoring.svc.cluster.local:8060/dingtalk/webhook1/send

image.png

注:url處可以直接使用的svc地址,格式為:servicename.namespace.svc.cluster.local

5影兽、測試釘釘接收告警

①峻堰、修改prometheus-rules.yaml中的規(guī)則
②捐名、查看prometheus Alerts中的狀態(tài)(pending或FIRING)
其中pending狀態(tài)為:已觸發(fā)告警,未發(fā)送成艘。
其中FIRING狀態(tài)為:已發(fā)送告警淆两。(具體信息請查看webhook-dingtalk 的pod日志)

image.png

image.png
最后編輯于
?著作權(quán)歸作者所有,轉(zhuǎn)載或內(nèi)容合作請聯(lián)系作者
  • 序言:七十年代末,一起剝皮案震驚了整個濱河市踱葛,隨后出現(xiàn)的幾起案子,更是在濱河造成了極大的恐慌盯另,老刑警劉巖洲赵,帶你破解...
    沈念sama閱讀 216,544評論 6 501
  • 序言:濱河連續(xù)發(fā)生了三起死亡事件芝发,死亡現(xiàn)場離奇詭異辅鲸,居然都是意外死亡独悴,警方通過查閱死者的電腦和手機(jī),發(fā)現(xiàn)死者居然都...
    沈念sama閱讀 92,430評論 3 392
  • 文/潘曉璐 我一進(jìn)店門,熙熙樓的掌柜王于貴愁眉苦臉地迎上來坟奥,“玉大人,你說我怎么就攤上這事筏勒」苄校” “怎么了邪媳?”我有些...
    開封第一講書人閱讀 162,764評論 0 353
  • 文/不壞的土叔 我叫張陵雨效,是天一觀的道長徽龟。 經(jīng)常有香客問我,道長耘沼,這世上最難降的妖魔是什么朱盐? 我笑而不...
    開封第一講書人閱讀 58,193評論 1 292
  • 正文 為了忘掉前任兵琳,我火速辦了婚禮躯肌,結(jié)果婚禮上清女,老公的妹妹穿的比我還像新娘。我一直安慰自己校仑,他們只是感情好迄沫,可當(dāng)我...
    茶點(diǎn)故事閱讀 67,216評論 6 388
  • 文/花漫 我一把揭開白布。 她就那樣靜靜地躺著尘吗,像睡著了一般睬捶。 火紅的嫁衣襯著肌膚如雪。 梳的紋絲不亂的頭發(fā)上近刘,一...
    開封第一講書人閱讀 51,182評論 1 299
  • 那天擒贸,我揣著相機(jī)與錄音,去河邊找鬼觉渴。 笑死介劫,一個胖子當(dāng)著我的面吹牛,可吹牛的內(nèi)容都是我干的案淋。 我是一名探鬼主播座韵,決...
    沈念sama閱讀 40,063評論 3 418
  • 文/蒼蘭香墨 我猛地睜開眼,長吁一口氣:“原來是場噩夢啊……” “哼踢京!你這毒婦竟也來了誉碴?” 一聲冷哼從身側(cè)響起宦棺,我...
    開封第一講書人閱讀 38,917評論 0 274
  • 序言:老撾萬榮一對情侶失蹤,失蹤者是張志新(化名)和其女友劉穎翔烁,沒想到半個月后,有當(dāng)?shù)厝嗽跇淞掷锇l(fā)現(xiàn)了一具尸體贩耐,經(jīng)...
    沈念sama閱讀 45,329評論 1 310
  • 正文 獨(dú)居荒郊野嶺守林人離奇死亡铡买,尸身上長有42處帶血的膿包…… 初始之章·張勛 以下內(nèi)容為張勛視角 年9月15日...
    茶點(diǎn)故事閱讀 37,543評論 2 332
  • 正文 我和宋清朗相戀三年景埃,在試婚紗的時候發(fā)現(xiàn)自己被綠了驯绎。 大學(xué)時的朋友給我發(fā)了我未婚夫和他白月光在一起吃飯的照片骗随。...
    茶點(diǎn)故事閱讀 39,722評論 1 348
  • 序言:一個原本活蹦亂跳的男人離奇死亡涨椒,死狀恐怖,靈堂內(nèi)的尸體忽然破棺而出,到底是詐尸還是另有隱情,我是刑警寧澤,帶...
    沈念sama閱讀 35,425評論 5 343
  • 正文 年R本政府宣布,位于F島的核電站,受9級特大地震影響泞坦,放射性物質(zhì)發(fā)生泄漏择吊。R本人自食惡果不足惜,卻給世界環(huán)境...
    茶點(diǎn)故事閱讀 41,019評論 3 326
  • 文/蒙蒙 一焕济、第九天 我趴在偏房一處隱蔽的房頂上張望。 院中可真熱鬧芍阎,春花似錦世曾、人聲如沸寿冕。這莊子的主人今日做“春日...
    開封第一講書人閱讀 31,671評論 0 22
  • 文/蒼蘭香墨 我抬頭看了看天上的太陽。三九已至钥星,卻和暖如春缕探,著一層夾襖步出監(jiān)牢的瞬間,已是汗流浹背琳骡。 一陣腳步聲響...
    開封第一講書人閱讀 32,825評論 1 269
  • 我被黑心中介騙來泰國打工剔猿, 沒想到剛下飛機(jī)就差點(diǎn)兒被人妖公主榨干…… 1. 我叫王不留,地道東北人。 一個月前我還...
    沈念sama閱讀 47,729評論 2 368
  • 正文 我出身青樓珠插,卻偏偏與公主長得像豺妓,于是被迫代替她去往敵國和親布讹。 傳聞我的和親對象是個殘疾皇子呼股,可洞房花燭夜當(dāng)晚...
    茶點(diǎn)故事閱讀 44,614評論 2 353

推薦閱讀更多精彩內(nèi)容