feat: add individual slides for each sub-system
This commit is contained in:
@@ -266,6 +266,219 @@ graph LR
|
|||||||
|
|
||||||
---
|
---
|
||||||
|
|
||||||
|
# 子系统 — Wayne(多集群容器管理)
|
||||||
|
|
||||||
|
<div class="grid grid-cols-2 gap-6 mt-4">
|
||||||
|
<div>
|
||||||
|
|
||||||
|
### 定位
|
||||||
|
多集群 Kubernetes 容器管理平台,统一管理 7 机房 RKE2 集群。
|
||||||
|
|
||||||
|
### 核心能力
|
||||||
|
- **多集群纳管** — 通过 Client-Go 对接各机房 RKE2 集群 API
|
||||||
|
- **应用部署** — 支持 Deployment、StatefulSet 等 K8s 工作负载管理
|
||||||
|
- **CI/CD 集成** — 对外提供 APIKey,GitLab CI 自动触发部署
|
||||||
|
- **一键回滚** — 应用发布异常时快速回滚至历史版本
|
||||||
|
|
||||||
|
</div>
|
||||||
|
<div>
|
||||||
|
|
||||||
|
### 关键对接
|
||||||
|
|
||||||
|
```mermaid
|
||||||
|
graph LR
|
||||||
|
CI["GitLab CI"] -->|APIKey 认证| Wayne["Wayne"]
|
||||||
|
Wayne -->|Client-Go| RKE2["RKE2 集群"]
|
||||||
|
Main["XINFRA 主系统"] -.->|SSO| Wayne
|
||||||
|
```
|
||||||
|
|
||||||
|
### 说明
|
||||||
|
- 独立 WebUI + API 服务
|
||||||
|
- APIKey 遵循最小权限原则
|
||||||
|
- 主系统通过 SSO 跳转,各自维护操作审计
|
||||||
|
|
||||||
|
</div>
|
||||||
|
</div>
|
||||||
|
|
||||||
|
---
|
||||||
|
|
||||||
|
# 子系统 — CloudDM(数据库管理与 SQL 审核)
|
||||||
|
|
||||||
|
<div class="grid grid-cols-2 gap-6 mt-4">
|
||||||
|
<div>
|
||||||
|
|
||||||
|
### 定位
|
||||||
|
SQL 审核与变更平台,统一管控数据库上线流程。
|
||||||
|
|
||||||
|
### 核心能力
|
||||||
|
- **SQL 审核** — 上线前自动检查 SQL 语句合规性与风险
|
||||||
|
- **多库支持** — 原生支持 MySQL,后续扩展 PostgreSQL 等
|
||||||
|
- **变更执行** — 审核通过后通过 Sidecar SQL 代理执行变更
|
||||||
|
- **操作审计** — 所有 SQL 操作全程记录,可追溯
|
||||||
|
|
||||||
|
</div>
|
||||||
|
<div>
|
||||||
|
|
||||||
|
### 关键对接
|
||||||
|
|
||||||
|
```mermaid
|
||||||
|
graph LR
|
||||||
|
User["DBA / 开发"] --> CloudDM["CloudDM"]
|
||||||
|
CloudDM -->|Sidecar 代理| MySQL[("MySQL")]
|
||||||
|
Deploy["服务部署完成"] -.->|自动注册| CloudDM
|
||||||
|
Main["XINFRA 主系统"] -.->|SSO| CloudDM
|
||||||
|
```
|
||||||
|
|
||||||
|
### 说明
|
||||||
|
- 基础服务交付流程中,MySQL 部署完成后自动注册至 CloudDM
|
||||||
|
- 白名单机制防止规则误判拦截合法 SQL
|
||||||
|
|
||||||
|
</div>
|
||||||
|
</div>
|
||||||
|
|
||||||
|
---
|
||||||
|
|
||||||
|
# 子系统 — CacheCloud(Redis 缓存管理)
|
||||||
|
|
||||||
|
<div class="grid grid-cols-2 gap-6 mt-4">
|
||||||
|
<div>
|
||||||
|
|
||||||
|
### 定位
|
||||||
|
Redis 实例生命周期管理平台,覆盖创建、监控、运维全流程。
|
||||||
|
|
||||||
|
### 核心能力
|
||||||
|
- **实例管理** — Redis 实例的创建、扩缩容、下线
|
||||||
|
- **Agent 模式** — 通过 Agent 远程管理各机房 Redis 实例
|
||||||
|
- **诊断工具** — 大 Key / 热 Key 检测,慢查询分析
|
||||||
|
- **监控集成** — 实例指标上报至 VictoriaMetrics
|
||||||
|
|
||||||
|
</div>
|
||||||
|
<div>
|
||||||
|
|
||||||
|
### 关键对接
|
||||||
|
|
||||||
|
```mermaid
|
||||||
|
graph LR
|
||||||
|
User["运维人员"] --> CacheCloud["CacheCloud"]
|
||||||
|
CacheCloud -->|Agent| Redis[("Redis")]
|
||||||
|
Deploy["服务部署完成"] -.->|自动注册| CacheCloud
|
||||||
|
Main["XINFRA 主系统"] -.->|SSO| CacheCloud
|
||||||
|
```
|
||||||
|
|
||||||
|
### 说明
|
||||||
|
- 基础服务交付流程中,Redis 部署完成后自动注册至 CacheCloud
|
||||||
|
- 配合应用侧治理解决大 Key / 热 Key 性能问题
|
||||||
|
|
||||||
|
</div>
|
||||||
|
</div>
|
||||||
|
|
||||||
|
---
|
||||||
|
|
||||||
|
# 子系统 — Apollo(配置中心)
|
||||||
|
|
||||||
|
<div class="grid grid-cols-2 gap-6 mt-4">
|
||||||
|
<div>
|
||||||
|
|
||||||
|
### 定位
|
||||||
|
携程开源的分布式配置中心,统一管理各业务线应用配置。
|
||||||
|
|
||||||
|
### 核心能力
|
||||||
|
- **多机房部署** — 支持 Cluster 模式,7 机房独立部署
|
||||||
|
- **配置灰度** — 配置变更可灰度发布,降低变更风险
|
||||||
|
- **版本回滚** — 配置历史版本管理,异常时一键回滚
|
||||||
|
- **操作审计** — 配置变更全程记录,可追溯
|
||||||
|
|
||||||
|
</div>
|
||||||
|
<div>
|
||||||
|
|
||||||
|
### 关键对接
|
||||||
|
|
||||||
|
```mermaid
|
||||||
|
graph LR
|
||||||
|
App["业务应用"] -->|ConfigService| Apollo["Apollo"]
|
||||||
|
Apollo -->|配置下发| RKE2["RKE2 集群"]
|
||||||
|
Main["XINFRA 主系统"] -.->|SSO| Apollo
|
||||||
|
```
|
||||||
|
|
||||||
|
### 说明
|
||||||
|
- 本地缓存降级保障多机房配置一致性
|
||||||
|
- 灰度发布验证避免配置下发错误
|
||||||
|
|
||||||
|
</div>
|
||||||
|
</div>
|
||||||
|
|
||||||
|
---
|
||||||
|
|
||||||
|
# 子系统 — Grafana(监控可视化)
|
||||||
|
|
||||||
|
<div class="grid grid-cols-2 gap-6 mt-4">
|
||||||
|
<div>
|
||||||
|
|
||||||
|
### 定位
|
||||||
|
统一监控可视化平台,对接 VictoriaMetrics 等数据源。
|
||||||
|
|
||||||
|
### 核心能力
|
||||||
|
- **仪表盘** — 集群、节点、应用多维度监控面板
|
||||||
|
- **PromQL 查询** — 直接查询 VictoriaMetrics 中的指标数据
|
||||||
|
- **告警可视化** — 告警规则与历史趋势展示
|
||||||
|
- **多数据源** — 支持 VictoriaMetrics、Zabbix 等多种数据源
|
||||||
|
|
||||||
|
</div>
|
||||||
|
<div>
|
||||||
|
|
||||||
|
### 关键对接
|
||||||
|
|
||||||
|
```mermaid
|
||||||
|
graph LR
|
||||||
|
VM["VictoriaMetrics"] -->|PromQL| Grafana["Grafana"]
|
||||||
|
Zabbix["Zabbix"] -->|数据源| Grafana
|
||||||
|
Main["XINFRA 主系统"] -.->|SSO| Grafana
|
||||||
|
```
|
||||||
|
|
||||||
|
### 说明
|
||||||
|
- 直接复用现有 Grafana 仪表盘,无需主系统重建监控视图
|
||||||
|
- 主系统资源状态看板侧重告警聚合,Grafana 侧重指标可视化
|
||||||
|
|
||||||
|
</div>
|
||||||
|
</div>
|
||||||
|
|
||||||
|
---
|
||||||
|
|
||||||
|
# 子系统 — qpass(统一告警与值班通知)
|
||||||
|
|
||||||
|
<div class="grid grid-cols-2 gap-6 mt-4">
|
||||||
|
<div>
|
||||||
|
|
||||||
|
### 定位
|
||||||
|
统一告警通知平台,对接夜莺告警引擎,推送至企业 IM。
|
||||||
|
|
||||||
|
### 核心能力
|
||||||
|
- **告警接收** — 接收夜莺(Nightingale)推送的告警事件
|
||||||
|
- **通知分发** — 推送至企业 IM(飞书/钉钉/企微等)
|
||||||
|
- **值班管理** — 值班排班、告警升级、认领处理
|
||||||
|
- **告警收敛** — 配合夜莺去重收敛,减少告警风暴
|
||||||
|
|
||||||
|
</div>
|
||||||
|
<div>
|
||||||
|
|
||||||
|
### 关键对接
|
||||||
|
|
||||||
|
```mermaid
|
||||||
|
graph LR
|
||||||
|
NE["夜莺<br/>Nightingale"] -->|告警推送| QPass["qpass"]
|
||||||
|
QPass -->|通知| IM["企业 IM"]
|
||||||
|
Main["XINFRA 主系统"] -.->|SSO| QPass
|
||||||
|
```
|
||||||
|
|
||||||
|
### 说明
|
||||||
|
- 告警链路:采集源 → VictoriaMetrics / Zabbix → 夜莺(去重收敛分级)→ qpass → 企业 IM
|
||||||
|
- 主系统资源状态看板展示告警概览,qpass 负责通知触达
|
||||||
|
|
||||||
|
</div>
|
||||||
|
</div>
|
||||||
|
|
||||||
|
---
|
||||||
|
|
||||||
# 平台分层架构 — 基础设施层
|
# 平台分层架构 — 基础设施层
|
||||||
|
|
||||||
<div class="mt-2">
|
<div class="mt-2">
|
||||||
|
|||||||
Reference in New Issue
Block a user