[PATCH v3] RDMA/rxe: Fix out-of-range unsigned-to-signed conversion for RDMA message in 2GiB size

From: Honggang LI

Date: Fri Oct 02 2026 - 10:25:31 EST


When RDMA READ request for 2GiB in single WR, res->read.resid is u32
0x80000000, which is INT_MIN (-2147483648).

payload = min_t(int, res->read.resid, mtu);

The `min_t` function will return -2147483648 for payload. The wrong
size is propagated through call chain, `read_reply` -> `prepare_ack_packet`
-> `rxe_init_packet` -> `alloc_skb` . `alloc_skb` failed because of
invalid size. The passive side failed to emit response packet for RDMA
READ request.

After fixed it, the active side of RDMA READ failed with error code
"IB_WC_LOC_PROT_ERR". When RDMA_READ_RESPONSE_FIRST packet recived by
the active side, `do_read` call `copy_data`. dma->resid is u32 0x80000000.

int resid = dma->resid;

This conversion set resid to -2147483648. `copy_data` abort as length
greater than resid.

RDMA SEND and WRITE 2GiB message works too, after fixed these two bugs.

Fixes: 8700e3e7c485 ("Soft RoCE driver")
Signed-off-by: Honggang LI <honggangli@xxxxxxx>
---
Change log:
v3 -> v2:
Rebased on branch wip/leon-for-next of tree
git://git.kernel.org/pub/scm/linux/kernel/git/rdma/rdma.git

v2 -> v1:
Use u32 for must-be-unsized quantities, no unsigned-to-signed conversion

drivers/infiniband/sw/rxe/rxe_loc.h | 4 ++--
drivers/infiniband/sw/rxe/rxe_mr.c | 8 ++++----
drivers/infiniband/sw/rxe/rxe_net.c | 2 +-
drivers/infiniband/sw/rxe/rxe_resp.c | 17 +++++++++--------
4 files changed, 16 insertions(+), 15 deletions(-)

diff --git a/drivers/infiniband/sw/rxe/rxe_loc.h b/drivers/infiniband/sw/rxe/rxe_loc.h
index 7c3cc48e845c..e57861a62823 100644
--- a/drivers/infiniband/sw/rxe/rxe_loc.h
+++ b/drivers/infiniband/sw/rxe/rxe_loc.h
@@ -64,7 +64,7 @@ int rxe_flush_pmem_iova(struct rxe_mr *mr, u64 iova, unsigned int length);
int rxe_mr_copy(struct rxe_mr *mr, u64 iova, void *addr,
unsigned int length, enum rxe_mr_copy_dir dir);
int copy_data(struct rxe_pd *pd, int access, struct rxe_dma_info *dma,
- void *addr, int length, enum rxe_mr_copy_dir dir);
+ void *addr, u32 length, enum rxe_mr_copy_dir dir);
int rxe_map_mr_sg(struct ib_mr *ibmr, struct scatterlist *sg,
int sg_nents, unsigned int *sg_offset);
enum resp_states rxe_mr_do_atomic_op(struct rxe_mr *mr, u64 iova, int opcode,
@@ -91,7 +91,7 @@ void rxe_mw_cleanup(struct rxe_pool_elem *elem);

/* rxe_net.c */
struct sk_buff *rxe_init_packet(struct rxe_dev *rxe, struct rxe_av *av,
- int paylen, struct rxe_pkt_info *pkt);
+ u32 paylen, struct rxe_pkt_info *pkt);
void rxe_put_skb(struct sk_buff *skb);
int rxe_prepare(struct rxe_av *av, struct rxe_pkt_info *pkt,
struct sk_buff *skb);
diff --git a/drivers/infiniband/sw/rxe/rxe_mr.c b/drivers/infiniband/sw/rxe/rxe_mr.c
index 615da4bb9a38..884e3953b870 100644
--- a/drivers/infiniband/sw/rxe/rxe_mr.c
+++ b/drivers/infiniband/sw/rxe/rxe_mr.c
@@ -418,13 +418,13 @@ int copy_data(
int access,
struct rxe_dma_info *dma,
void *addr,
- int length,
+ u32 length,
enum rxe_mr_copy_dir dir)
{
- int bytes;
+ u32 bytes;
struct rxe_sge *sge = &dma->sge[dma->cur_sge];
- int offset = dma->sge_offset;
- int resid = dma->resid;
+ u32 offset = dma->sge_offset;
+ u32 resid = dma->resid;
struct rxe_mr *mr = NULL;
u64 iova;
int err;
diff --git a/drivers/infiniband/sw/rxe/rxe_net.c b/drivers/infiniband/sw/rxe/rxe_net.c
index 9f1c7f21d88d..c572cda8fe18 100644
--- a/drivers/infiniband/sw/rxe/rxe_net.c
+++ b/drivers/infiniband/sw/rxe/rxe_net.c
@@ -571,7 +571,7 @@ int rxe_xmit_packet(struct rxe_qp *qp, struct rxe_pkt_info *pkt,
}

struct sk_buff *rxe_init_packet(struct rxe_dev *rxe, struct rxe_av *av,
- int paylen, struct rxe_pkt_info *pkt)
+ u32 paylen, struct rxe_pkt_info *pkt)
{
unsigned int hdr_len;
struct sk_buff *skb = NULL;
diff --git a/drivers/infiniband/sw/rxe/rxe_resp.c b/drivers/infiniband/sw/rxe/rxe_resp.c
index ba3b2d23b36b..1b7f31737225 100644
--- a/drivers/infiniband/sw/rxe/rxe_resp.c
+++ b/drivers/infiniband/sw/rxe/rxe_resp.c
@@ -614,7 +614,7 @@ static enum resp_states check_rkey(struct rxe_qp *qp,
}

static enum resp_states send_data_in(struct rxe_qp *qp, void *data_addr,
- int data_len)
+ u32 data_len)
{
int err;

@@ -829,20 +829,21 @@ static enum resp_states atomic_write_reply(struct rxe_qp *qp,
static struct sk_buff *prepare_ack_packet(struct rxe_qp *qp,
struct rxe_pkt_info *ack,
int opcode,
- int payload,
+ u32 payload,
u32 psn,
u8 syndrome)
{
struct rxe_dev *rxe = to_rdev(qp->ibqp.device);
struct sk_buff *skb;
- int paylen;
- int pad;
+ u32 paylen;
+ u32 pad = 0;
int err;

/*
* allocate packet
*/
- pad = (-payload) & 0x3;
+ if (payload % 4)
+ pad = 4 - payload % 4;
paylen = rxe_opcode[opcode].length + payload + pad + RXE_ICRC_SIZE;

skb = rxe_init_packet(rxe, &qp->pri_av, paylen, ack);
@@ -936,9 +937,9 @@ static enum resp_states read_reply(struct rxe_qp *qp,
{
struct rxe_pkt_info ack_pkt;
struct sk_buff *skb;
- int mtu = qp->mtu;
+ u32 mtu = qp->mtu;
enum resp_states state;
- int payload;
+ u32 payload;
int opcode;
int err;
struct resp_res *res = qp->resp.res;
@@ -984,7 +985,7 @@ static enum resp_states read_reply(struct rxe_qp *qp,

res->state = rdatm_res_state_next;

- payload = min_t(int, res->read.resid, mtu);
+ payload = min(res->read.resid, mtu);

skb = prepare_ack_packet(qp, &ack_pkt, opcode, payload,
res->cur_psn, AETH_ACK_UNLIMITED);
--
2.55.0