---
title: 备份的 NFS 卡住导致无法备份和停止备份-OceanBase数据库使用指南
description: 了解OceanBase数据库在实际应用中关于 备份的 NFS 卡住导致无法备份和停止备份相关的常见问题和使用技巧，帮助您快速解决 备份的 NFS 卡住导致无法备份和停止备份的难题。
---
切换语言

- 简体中文
- English

划线反馈

# 备份的 NFS 卡住导致无法备份和停止备份

更新时间：2025-08-25 01:47

适用版本： V2.2.x、V3.1.x、V3.2.x 内容类型：How-to  

NFS 介质出现问题，日志备份已经停止，但是无法停止正在运行的备份，使用 `ALTER SYSTEM CANCEL BACKUP` 和 `ALTER SYSTEM CANCEL ALL BACKUP FORCE;` 也无法停止。

## 排查方法

- 看操作系统的报错日志。

  ```shell
  cat /var/log/messages |grep nfs

  ```

  返回结果如下：

  ```shell
  Jan 18 05:23:41 observer1 kernel: nfs: server xx.xx.xx.xx not responding, still trying
  Jan 18 05:23:41 observer1 kernel: nfs: server xx.xx.xx.xx not responding, still trying
  Jan 18 05:23:41 observer1 kernel: nfs: server xx.xx.xx.xx not responding, still trying

  ```
 - 查看 nfsiostat。

  如果 op/s 很大，但是 kB/s 几乎为 0，则大概率 NFS hung 住了。具体命令如下：

  ```shell
  nfsiostat 2

  ```

  返回结果如下：

  ```shell
  XX.XX.XX.XX:/fs/nfs_pool/nfspool mounted on /obbackup:

  op/s         rpc bklog
  1137.50    0.00
  read:            ops/s             kB/s           kB/op         retrans         avg RTT (ms)    avg exe (ms)
                  0.000   0.000      0.000       0 (0.0%)    0.000   0.000
  write:           ops/s             kB/s           kB/op         retrans         avg RTT (ms)    avg exe (ms)
                  0.000   0.000      0.000       0 (0.0%)    0.000   0.000

  XX.XX.XX.XX:/fs/nfs_pool/nfspool mounted on /obbackup:

  op/s         rpc bklog
  1062.00    0.00
  read:            ops/s             kB/s           kB/op         retrans         avg RTT (ms)    avg exe (ms)
                  0.000   0.000      0.000       0 (0.0%)    0.000   0.000
  write:           ops/s             kB/s           kB/op         retrans         avg RTT (ms)    avg exe (ms)
                  0.000   0.000      0.000       0 (0.0%)    0.000   0.000

  op/s         rpc bklog
  1119.00    0.00
  read:            ops/s             kB/s           kB/op         retrans         avg RTT (ms)    avg exe (ms)
                  0.000   0.000      0.000       0 (0.0%)    0.000   0.000
  write:           ops/s             kB/s           kB/op         retrans         avg RTT (ms)    avg exe (ms)
                  0.000   0.000      0.000       0 (0.0%)    0.000   0.000

  ```
 - 通过 pstack 来验证。

  注意，在 pstack 之前，需要把 Leader 和 RS 给切走，如果 pstack 不出来，大概率是 NFS hung 住了。
 - 通过执行 strace 命令。

  如果 strace 到 nfs 挂在的目录上 hung 住了，很可能就是 NFS hung 住了，具体操作如下：

  ```bash
  strace df —h
  或者
  strace ls backup_path

  ```

  ![2](https://obbusiness-private.oss-cn-shanghai.aliyuncs.com/doc/img/knowledge-base/database/backup-and-restore/4700.nfs-stuck-causing-inability-to-backup-and-stopping-backup/2.png)

## 恢复的步骤

在进行以下操作时，需要先暂停备份和归档。

- 优先让 NFS 服务恢复正常，只要 NFS 服务能恢复正常，ObServer 会自动恢复，不需要运维操作。

     1. 先排查 NFS Server 端的问题，如果 NFS Server 有问题，麻烦先找 NFS 厂家运维支持。
     2. 再排查 ObServer 和 NFS Server 之间的网络是否有问题。
            1. 观察 ifconfig 里面网卡的 Error 或者 DROP 个数。
            2. 查看 tsar --live 中的 retran， 如果超过 0.2 一般认为网络有问题。
            3. 可以尝试访问备份的目录，或者跑一个 fio 测试下 NFS 的情况，观察 nfsiostat 2 的监控是否正常。
 - 如果 NFS 服务无法恢复正常，那么只能考虑更换 NFS 服务，操作流程如下：

     1. umount 所有 NFS client。

       #### 注意

       不能用 umount -l （lazy）的方式，这个没有实际卸载。
     2. 重启 NFS Server 所在的物理机器。
     3. 重启 observer 物理机器（需要一台一台重启）。

## 适用版本

OceanBase 数据库 V2.2.x、V3.x 版本。

Previous

[备份期间持有 tablet handle 引用计数导致 MemStore 不释放导致租户内存使用飙高](https://www.oceanbase.com/knowledge-base/oceanbase-database-1000000001687594)

Next

[OceanBase 数据库增量备份报 4201](https://www.oceanbase.com/knowledge-base/oceanbase-database-1000000000208051) ![有帮助](https://gw.alipayobjects.com/mdn/ob_asset/afts/img/A*y6ocSqN8cqsAAAAAAAAAAAAAARQnAQ)![无帮助](https://gw.alipayobjects.com/mdn/ob_asset/afts/img/A*BG9IQJyLHF8AAAAAAAAAAAAAARQnAQ)![反馈](https://gw.alipayobjects.com/mdn/ob_asset/afts/img/A*eTWdQKCRKHwAAAAAAAAAAAAAARQnAQ)[AI](https://www.oceanbase.com/obi) 咨询热线
