最新发布第113页
StatefulSet扩缩容与更新策略-AI运维探索者

StatefulSet扩缩容与更新策略

一、StatefulSet扩缩容 和 Deployment 类似,可以通过更新 replicas 字段扩容/缩容 StatefulSet,也可以使用 `kubectl scale`、`kubectl edit` 和 `kubectl patch` 来扩容/缩容一个 StatefulSet...
Alertmanager入门:核心概念与主要功能-AI运维探索者

Alertmanager入门:核心概念与主要功能

一、Alertmanager基本概念 Prometheus 警报分为两部分。Prometheus 服务器中的警报规则将警报发送到警报管理器。然后,Alertmanager 管理这些警报,包括沉默、抑制、聚合以及通过电子邮件、待命...
Kubernetes网络:Pod网络-AI运维探索者

Kubernetes网络:Pod网络

一、Pod网络简介 在K8S集群里,多个节点上的Pod相互通信,要通过网络插件来完成,比如Calico网络插件。 使用kubeadm初始化K8S集群时,有指定一个参数--pod-network-cidr=10.18.0.0/16 它用来定...
Jenkins 凭证管理实践:Secrets、安全使用与 Vault 集成-AI运维探索者

Jenkins 凭证管理实践:Secrets、安全使用与 Vault 集成

一、如何在Jenkins中安全管理Secrets 1.1 如何在Jenkins中安全管理Secrets CI/CD 流水线是 DevOps 团队软件交付过程的基本组成部分。 该流水线利用自动化和持续监控来实现软件的无缝交付。通过...
Kubernetes节点维护不中断实战:taint、drain 与 PDB 组合使用-AI运维探索者

Kubernetes节点维护不中断实战:taint、drain 与 PDB 组合使用

一、问题三:节点维护如何不影响服务? 在 Kubernetes 集群中,节点维护(如版本升级、系统升级、漏洞修复)时,可通过以下策略确保服务不受影响: 1、标记节点为不可调度 * **添加污点(Taint)...
MongoDB 调整 oplog大小引发的从库宕机-AI运维探索者

MongoDB 调整 oplog大小引发的从库宕机

一、背景 为了调大 oplog window 窗口时间,在调大 oplog 的值后,引发了从库宕机。 **日志抓取:** 二、原因 在本案例中存在延迟从库的问题,延迟从库由于延迟,还没有应用到 oplog 就被 'drop'了,...
PostgreSQL Commit Log 与事务 ID 原理-AI运维探索者

PostgreSQL Commit Log 与事务 ID 原理

一、CommitLog文件做什么的 PostgreSQL把事务状态记录在CommitLog中 从PostgreSQL10版本开始,CLOG文件是在pg_xact子目录下 前面也介绍过事务的状态有以下4种 CommitLog文件是一个位图文件,因...
大模型选型指南:性能、参数与安全性-AI运维探索者

大模型选型指南:性能、参数与安全性

一、性能与场景适配度 1.1 通用能力 评估模型在数学推理、代码生成、多语言支持等通用任务上的表现。例如,通义千问在多项评测中表现突出,DeepSeek-R1 在复杂推理任务中也有明显优势。 1.2 行...
Kubernetes污点Taint入门:概念、背景、场景与内置类型-AI运维探索者

Kubernetes污点Taint入门:概念、背景、场景与内置类型

一、什么是污点 Taint作用在节点上,能够使节点排斥一类特定的Pod,也就是不能“兼容”该节点的污点的Pod。 **注意:一个节点可以部署多个污点!!!** 二、污点出现背景 之所以出现污点,是因为要...
Dify+Grafana运维实践:Grafana、Loki 与 Promtail 搭建-AI运维探索者

Dify+Grafana运维实践:Grafana、Loki 与 Promtail 搭建

一、安装 Grafana 官网下载地址: https://grafana.com/grafana/download 由于官网下载很慢,所以可以配置一个阿里云的源 vi /etc/yum.repos.d/grafana.repo 内容如下 用dnf安装grafana 启动服...