运维部署及管理
本章覆盖如何在自有基础设施上运行 GreptimeDB。先看架构,明确需要部署和运维哪些组件。GreptimeCloud 运行同一套引擎,以托管服务的形式提供,部署和维护由平台负责。
部署
- 配置——首次部署前需要确认的协议、存储和运行时设置。
- 在 Kubernetes 上部署——通过 GreptimeDB Operator 部署。
- 容量规划——按写入量和查询负载规划计算资源、内存和本地缓存。
- 鉴权——默认不启用。
- 在 Android 上运行——用于 Android 设备上的边缘部署。
运维
- 监控——通过指标、trace 和运行时信息掌握集群健康状况与性能。
- 表与 Region 运维——表操作、分片、Region 迁移与 failover、重分区、compaction 和垃圾回收。
- 元数据存储——集群依赖的元数据后端。
- 维护操作——集群维护模式、集群恢复模式、表元数据修复和资源标识管理。
- 升级——把部署升级到新版本。
- 故障排查——收集定位问题所需的信息。
持久性与恢复
- 预写日志(WAL)——本地 WAL 与 Remote WAL,其中 Remote WAL 配置是集群 failover 的前提。
- 容灾——备份、恢复和跨区域方案。