技能库 1304 个
更多分类(194)
Sandbox 管理
管理 Pod 沙箱(sandbox)与容器组,支持 Kubernetes 集成场景下的沙箱生命周期、配置与监控
Docker Compose 编排
使用 docker-compose.yml 定义多容器应用,配置网络、卷、环境变量等,实现微服务或中间件集群的快速部署与管理。
Docker Swarm集群管理
初始化Docker Swarm集群、部署服务、动态扩缩容、执行滚动更新及故障恢复
镜像构建与仓库管理
构建、标记、推送 Docker 镜像到 Docker Hub 或私有仓库,并清理本地无用镜像
数据卷与存储管理
管理 Docker 数据卷与绑定挂载,确保容器化应用的数据持久化、共享与迁移安全。
Docker安全最佳实践
为Docker容器和镜像实施最小权限、非root运行、镜像扫描、Seccomp等安全策略,降低安全风险。
容器生命周期管理
创建、启动、停止、重启、删除容器,并处理日志和资源限制
Docker网络配置
配置bridge、host、overlay等网络模式,实现容器间通信与端口映射
Dockerfile编写与优化
编写高效、安全的多阶段Dockerfile,减少镜像层数和大小,适用于云计算与中间件场景
cgroup资源限制配置
根据容器资源需求,精确配置CPU、内存、IO等cgroup子系统参数,实现容器资源隔离与限制
容器运行时安全策略配置
配置 seccomp、AppArmor/SELinux、capabilities 限制容器权限,降低容器逃逸与权限提升风险
runc容器启动故障排查
分析runc创建容器时OOM、挂载失败等错误,定位cgroup或内核问题
Kubernetes CRI适配与调试
确保容器运行时符合CRI接口规范,处理kubelet与运行时通信异常
容器日志收集与解析
配置容器 stdout/stderr 日志驱动,使用 Fluentd 或 Filebeat 进行日志聚合与解析,实现可观测性
容器网络接口调试
使用 ip netns、tcpdump 等工具诊断容器网络连通性和性能问题
容器运行时性能基准测试
使用stress、sysbench等工具对容器进行CPU、内存和网络压力测试,评估容器运行时性能基准。
容器镜像层缓存优化
利用 overlayfs 特性,设计分层缓存策略,减少镜像拉取和构建时间,提升容器运行时效率。
Longhorn 故障诊断与日志分析
定位卷挂载失败、重建缓慢、数据不一致等问题,分析 Longhorn 组件日志和事件
监控与告警集成
集成 Prometheus + Grafana 监控 GlusterFS 集群关键指标,并配置告警规则实现故障预警与性能告警。
扩容与缩容规划
设计 GlusterFS 集群横向扩展方案,安全添加或移除节点,执行数据重平衡,评估容量与性能影响。
GlusterFS 性能调优
调整 I/O 线程数、缓存大小、网络参数等优化读写性能,使用 fio/iperf 测试
安全与访问控制
为 GlusterFS 集群配置 SSL/TLS 加密、基于 IP 和用户认证、卷的 ACL 设置
快照与备份恢复
创建、删除、调度 GlusterFS 卷快照,从快照恢复数据,并配置异地备份策略。
GlusterFS 集群部署配置
基于 Ansible/Puppet 自动化部署 GlusterFS 集群,配置卷类型、复制因子、仲裁等参数