本文介绍Ceph存储集群的部署与运维实践,涵盖Docker和Kubernetes两种部署方式,并重点展示常用运维命令及异常处理。通过ceph -s可查看集群健康状态、MON/MGR/OSD等组件运行情况;ceph df与ceph osd df用于查看存储池与OSD的容量使用分布;ceph crash ls/info用于排查守护进程崩溃记录,结合ceph health detail定位具体故障。文中示例显示集群曾出现OSD.0崩溃导致的HEALTH_WARN,并提供了“mon低可用空间”告警的解决参考链接。读者可按命令输出快速掌握集群健康度、容量水位和故障排查方法,适合Ceph管理员在实际环境中对照操作。