net/mlx5e: Fix potential deadlock by deferring RX timeout recovery

author Shahar Shitrit <shshitrit@nvidia.com>

Wed, 23 Jul 2025 07:44:32 +0000 (10:44 +0300)

committer Jakub Kicinski <kuba@kernel.org>

Fri, 25 Jul 2025 18:00:17 +0000 (11:00 -0700)
author Shahar Shitrit <shshitrit@nvidia.com>
Wed, 23 Jul 2025 07:44:32 +0000 (10:44 +0300)
committer Jakub Kicinski <kuba@kernel.org>
Fri, 25 Jul 2025 18:00:17 +0000 (11:00 -0700)
diff --git a/drivers/net/ethernet/mellanox/mlx5/core/en.h b/drivers/net/ethernet/mellanox/mlx5/core/en.h

index 5b0d03b3efe8284f0594d9c622f240b0a803e8dc..48bcd6813aff45323914ceb2148bafd68eec48f1 100644 (file)
--- a/drivers/net/ethernet/mellanox/mlx5/core/en.h
+++ b/drivers/net/ethernet/mellanox/mlx5/core/en.h
@@ -728,6 +728,7 @@ struct mlx5e_rq {
         struct xsk_buff_pool  *xsk_pool;
  
         struct work_struct     recover_work;
+       struct work_struct     rx_timeout_work;
  
         /* control */
         struct mlx5_wq_ctrl    wq_ctrl;
diff --git a/drivers/net/ethernet/mellanox/mlx5/core/en/reporter_rx.c b/drivers/net/ethernet/mellanox/mlx5/core/en/reporter_rx.c

index e75759533ae0c4a194cc97f55a7878792e2d3519..16c44d628eda65fbc3aba55ed7ebb0df47638508 100644 (file)
--- a/drivers/net/ethernet/mellanox/mlx5/core/en/reporter_rx.c
+++ b/drivers/net/ethernet/mellanox/mlx5/core/en/reporter_rx.c
@@ -170,16 +170,23 @@ static int mlx5e_rx_reporter_err_rq_cqe_recover(void *ctx)
  static int mlx5e_rx_reporter_timeout_recover(void *ctx)
  {
         struct mlx5_eq_comp *eq;
+       struct mlx5e_priv *priv;
         struct mlx5e_rq *rq;
         int err;
  
         rq = ctx;
+       priv = rq->priv;
+
+       mutex_lock(&priv->state_lock);
+
         eq = rq->cq.mcq.eq;
  
         err = mlx5e_health_channel_eq_recover(rq->netdev, eq, rq->cq.ch_stats);
         if (err && rq->icosq)
                 clear_bit(MLX5E_SQ_STATE_ENABLED, &rq->icosq->state);
  
+       mutex_unlock(&priv->state_lock);
+
         return err;
  }
  
diff --git a/drivers/net/ethernet/mellanox/mlx5/core/en_main.c b/drivers/net/ethernet/mellanox/mlx5/core/en_main.c

index ea822c69d137b24d8801ec57d28783da110c5c6e..16d818943487b210781255a487ee0c3bfa2944d6 100644 (file)
--- a/drivers/net/ethernet/mellanox/mlx5/core/en_main.c
+++ b/drivers/net/ethernet/mellanox/mlx5/core/en_main.c
@@ -707,6 +707,27 @@ static void mlx5e_rq_err_cqe_work(struct work_struct *recover_work)
         mlx5e_reporter_rq_cqe_err(rq);
  }
  
+static void mlx5e_rq_timeout_work(struct work_struct *timeout_work)
+{
+       struct mlx5e_rq *rq = container_of(timeout_work,
+                                          struct mlx5e_rq,
+                                          rx_timeout_work);
+
+       /* Acquire netdev instance lock to synchronize with channel close and
+        * reopen flows. Either successfully obtain the lock, or detect that
+        * channels are closing for another reason, making this work no longer
+        * necessary.
+        */
+       while (!netdev_trylock(rq->netdev)) {
+               if (!test_bit(MLX5E_STATE_CHANNELS_ACTIVE, &rq->priv->state))
+                       return;
+               msleep(20);
+       }
+
+       mlx5e_reporter_rx_timeout(rq);
+       netdev_unlock(rq->netdev);
+}
+
  static int mlx5e_alloc_mpwqe_rq_drop_page(struct mlx5e_rq *rq)
  {
         rq->wqe_overflow.page = alloc_page(GFP_KERNEL);
@@ -830,6 +851,7 @@ static int mlx5e_alloc_rq(struct mlx5e_params *params,
  
         rqp->wq.db_numa_node = node;
         INIT_WORK(&rq->recover_work, mlx5e_rq_err_cqe_work);
+       INIT_WORK(&rq->rx_timeout_work, mlx5e_rq_timeout_work);
  
         if (params->xdp_prog)
                 bpf_prog_inc(params->xdp_prog);
@@ -1204,7 +1226,8 @@ int mlx5e_wait_for_min_rx_wqes(struct mlx5e_rq *rq, int wait_time)
         netdev_warn(rq->netdev, "Failed to get min RX wqes on Channel[%d] RQN[0x%x] wq cur_sz(%d) min_rx_wqes(%d)\n",
                     rq->ix, rq->rqn, mlx5e_rqwq_get_cur_sz(rq), min_wqes);
  
-       mlx5e_reporter_rx_timeout(rq);
+       queue_work(rq->priv->wq, &rq->rx_timeout_work);
+
         return -ETIMEDOUT;
  }
  
@@ -1375,6 +1398,7 @@ void mlx5e_close_rq(struct mlx5e_rq *rq)
         if (rq->dim)
                 cancel_work_sync(&rq->dim->work);
         cancel_work_sync(&rq->recover_work);
+       cancel_work_sync(&rq->rx_timeout_work);
         mlx5e_destroy_rq(rq);
         mlx5e_free_rx_descs(rq);
         mlx5e_free_rq(rq);
author	Shahar Shitrit <shshitrit@nvidia.com>
	Wed, 23 Jul 2025 07:44:32 +0000 (10:44 +0300)
committer	Jakub Kicinski <kuba@kernel.org>
	Fri, 25 Jul 2025 18:00:17 +0000 (11:00 -0700)
drivers/net/ethernet/mellanox/mlx5/core/en.h		patch \| blob \| blame \| history
drivers/net/ethernet/mellanox/mlx5/core/en/reporter_rx.c		patch \| blob \| blame \| history
drivers/net/ethernet/mellanox/mlx5/core/en_main.c		patch \| blob \| blame \| history