Pith. sign in

Paper Citation Record · LEDGER

REARANK: Reasoning Re-ranking Agent via Reinforcement Learning

As of 8 August 2026, this Paper Citation Record lists 44 of 44 outbound references and 7 inbound Pith citation observations for arXiv:2505.20046.

A citation records a reference. It does not transfer a finding from one paper to another.

pith.paper-citation-record.v1
2505.20046 v1

Coverage vector

measured 44 of 44 reference resolution

Typed states for the displayed outbound observations.

Source: paper_references, paper_reference_links, observed 2026-08-07T14:07:15.898573Z

measured 51 of 51 standing notices

One-hop event checks from named stored sources.

Source: scholarly_work_events, retraction_status_cache, observed 2026-08-08T06:32:00.761636+00:00

measured 7 of 7 inbound itemization

Pith citing papers itemized under the disclosed page cap.

Source: paper_references, paper_reference_links, observed 2026-08-07T00:22:24.214754Z

measured 0 of 1 external citation measurements

A source-named dated measurement, never combined with another source.

Source: arxiv_reference, observed 2026-05-18T23:56:55.107569Z

Reference resolution

44 of 44 outbound references displayed

  • verified exact1
  • verified fuzzy0
  • unresolved43
  • parse uncertain0
  • malformed identifier0
  • metadata mismatch0

External citation measurements

No source-named external measurement is stored.

Outbound references

Observation e1c5c600-b5ad-4632-bbbb-6769888ab87c · outbound

This paper cites GPT-4 Technical Report.

REARANK: Reasoning Re-ranking Agent via Reinforcement Learning GPT-4 Technical Report

Reference 1

Resolution
unresolved
no resolver link, observed 2026-08-07T14:07:11.863636Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=arxiv_source observed=2026-08-07T14:07:11.863636Z digest=sha256:f2420139ca103598322a0f0faccf8deef41515ea8557986b294c6b9b6178c3f5

Observation 75c105d8-9080-4f43-b9eb-44f8cfd06f79 · outbound

This paper cites LLM2Vec: Large Language Models Are Secretly Powerful Text Encoders.

REARANK: Reasoning Re-ranking Agent via Reinforcement Learning LLM2Vec: Large Language Models Are Secretly Powerful Text Encoders

Reference 2

Resolution
unresolved
no resolver link, observed 2026-08-07T14:07:11.928833Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=arxiv_source observed=2026-08-07T14:07:11.928833Z digest=sha256:613b01052cc28cf4c13054f5b947071057612df37cedc466da71903265f776c6

Observation 77130b62-65b6-4a3f-9646-9942139c28d1 · outbound

This paper cites an unresolved cited work.

REARANK: Reasoning Re-ranking Agent via Reinforcement Learning Unresolved cited work

Reference 3

Resolution
unresolved
no resolver link, observed 2026-08-07T14:07:12.013949Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=arxiv_source observed=2026-08-07T14:07:12.013949Z digest=sha256:eac81ef3d1d2a8f29f90bda5e47b06d1659dc1de6161b79572d15687512a255c

Observation 0eca5c43-d392-4839-83b5-154c336b9c1e · outbound

This paper cites Overview of the TREC 2019 deep learning track.

REARANK: Reasoning Re-ranking Agent via Reinforcement Learning Overview of the TREC 2019 deep learning track

Reference 5

Resolution
unresolved
no resolver link, observed 2026-08-07T14:07:12.186322Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=arxiv_source observed=2026-08-07T14:07:12.186322Z digest=sha256:9fe4e123ce2681cdf657d141c38ac0d7c268148945c479f06fdbbc1e8a7054f6

Observation 4f780dec-d5f7-4ec3-88cf-b6f21387737d · outbound

This paper cites an unresolved cited work.

REARANK: Reasoning Re-ranking Agent via Reinforcement Learning Unresolved cited work

Reference 6

Resolution
unresolved
no resolver link, observed 2026-08-07T14:07:12.278805Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=arxiv_source observed=2026-08-07T14:07:12.278805Z digest=sha256:02c11c6e17c32b735239cce19c9e33eae3256410de85beaa50be6defd09e0f74

Observation 1819c3a8-98cd-4df3-884f-2a4c8a9a5426 · outbound

This paper cites an unresolved cited work.

REARANK: Reasoning Re-ranking Agent via Reinforcement Learning Unresolved cited work

Reference 7

Resolution
unresolved
raw_fallback, observed 2026-08-07T14:07:17.498898Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.

source=arxiv_source observed=2026-08-07T14:07:12.333196Z digest=sha256:945c4c24ec269d37fccad98cc837bde535ad8847329e934fe7ec79b0b15e6b80

Observation 8f5bad58-10d1-4446-b8cc-811dc36790f4 · outbound

This paper cites DeepSeek-R1: Incentivizing Reasoning Capability in LLMs via Reinforcement Learning.

REARANK: Reasoning Re-ranking Agent via Reinforcement Learning DeepSeek-R1: Incentivizing Reasoning Capability in LLMs via Reinforcement Learning

Reference 8

Resolution
unresolved
no resolver link, observed 2026-08-07T14:07:12.431132Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=arxiv_source observed=2026-08-07T14:07:12.431132Z digest=sha256:979b7bf4d2d84b6ce3bfd1c7d579de65d3dff6c13d578e1cca94a8347cecbb4b

Observation 8f76fa81-6b56-4342-95fa-5de23e6af88d · outbound

This paper cites an unresolved cited work.

REARANK: Reasoning Re-ranking Agent via Reinforcement Learning Unresolved cited work

Reference 9

Resolution
unresolved
no resolver link, observed 2026-08-07T14:07:12.554615Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=arxiv_source observed=2026-08-07T14:07:12.554615Z digest=sha256:1c0702e926dad60727703b900339d29ee68affb73634e09ca71e06ec14e325ae

Observation 5ebc3e12-4cd2-4b97-a5ce-3c9056502b12 · outbound

This paper cites NV-Embed: Improved Techniques for Training LLMs as Generalist Embedding Models.

REARANK: Reasoning Re-ranking Agent via Reinforcement Learning NV-Embed: Improved Techniques for Training LLMs as Generalist Embedding Models

Reference 10

Resolution
unresolved
no resolver link, observed 2026-08-07T14:07:12.642594Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=arxiv_source observed=2026-08-07T14:07:12.642594Z digest=sha256:5c65616131d0d51ce7557efb11b8b4a916bedb2b6bb3bb886b7b8e4b0998b8b7

Observation 1cb00cf5-5414-4f55-919f-483caf7995b2 · outbound

This paper cites u ttler, Mike Lewis, Wen-tau Yih, Tim Rockt \.

REARANK: Reasoning Re-ranking Agent via Reinforcement Learning u ttler, Mike Lewis, Wen-tau Yih, Tim Rockt \

Reference 11

Resolution
unresolved
no resolver link, observed 2026-08-07T14:07:12.728412Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=arxiv_source observed=2026-08-07T14:07:12.728412Z digest=sha256:fa40ff323b31d9bfa6d97e850bcf50889ff67be5984476fc89673b63d61691e8

Observation 2fa802e0-ff55-4d3e-a7f4-23a95b019711 · outbound

This paper cites Holistic Evaluation of Language Models.

REARANK: Reasoning Re-ranking Agent via Reinforcement Learning Holistic Evaluation of Language Models

Reference 12

Resolution
unresolved
no resolver link, observed 2026-08-07T14:07:12.880824Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=arxiv_source observed=2026-08-07T14:07:12.880824Z digest=sha256:a5278dd741039e9f154d2cda52c931eb30999c03b0c2ce9215d7e4f61466fbb2

Observation d4379efc-d361-4030-9224-85a752862fcf · outbound

This paper cites an unresolved cited work.

REARANK: Reasoning Re-ranking Agent via Reinforcement Learning Unresolved cited work

Reference 13

Resolution
unresolved
raw_fallback, observed 2026-08-07T14:07:17.371527Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.

source=arxiv_source observed=2026-08-07T14:07:12.949364Z digest=sha256:7487e3357145c2fcb43a8676b9000f02a3b81f63d0738ef8c0b05b648e86d8e6

Observation 019d401d-c136-41a9-9146-769b6c9d9e0d · outbound

This paper cites an unresolved cited work.

REARANK: Reasoning Re-ranking Agent via Reinforcement Learning Unresolved cited work

Reference 14

Resolution
unresolved
raw_fallback, observed 2026-08-07T14:07:17.236872Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.

source=arxiv_source observed=2026-08-07T14:07:13.030726Z digest=sha256:d049278839c1e6c83daf1caea4221eb22ddc7610531caaae5ebd01b12513c825

Observation 06b560b1-34e2-47b0-aea1-c199707b655e · outbound

This paper cites Zero-Shot Listwise Document Reranking with a Large Language Model.

REARANK: Reasoning Re-ranking Agent via Reinforcement Learning Zero-Shot Listwise Document Reranking with a Large Language Model

Reference 15

Resolution
unresolved
no resolver link, observed 2026-08-07T14:07:13.130568Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=arxiv_source observed=2026-08-07T14:07:13.130568Z digest=sha256:e55a048be9f28c9aa76c0c5dda7a5e77bacdb6aa687a19282f3fd1b67c9d3335

Observation 14b0a914-6e7a-4a45-90cf-3d6ed6589b3e · outbound

This paper cites an unresolved cited work.

REARANK: Reasoning Re-ranking Agent via Reinforcement Learning Unresolved cited work

Reference 16

Resolution
unresolved
no resolver link, observed 2026-08-07T14:07:13.230177Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=arxiv_source observed=2026-08-07T14:07:13.230177Z digest=sha256:a7d71377ca4f37ac1bc11a28c3a00073b20e9a04afe171787af6602e7f324fa4

Observation eb040adb-49b5-44bd-9cbd-665633845071 · outbound

This paper cites RankVicuna: Zero-Shot Listwise Document Reranking with Open-Source Large Language Models.

REARANK: Reasoning Re-ranking Agent via Reinforcement Learning RankVicuna: Zero-Shot Listwise Document Reranking with Open-Source Large Language Models

Reference 17

Resolution
unresolved
no resolver link, observed 2026-08-07T14:07:13.357576Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=arxiv_source observed=2026-08-07T14:07:13.357576Z digest=sha256:0c8e14f43eeb1a0483e9e9d17038114ef9e8eb233043c283631da44cf6856a79

Observation 32b928cf-b0f8-40d2-96ea-82ae0738ce61 · outbound

This paper cites RankZephyr: Effective and Robust Zero-Shot Listwise Reranking is a Breeze!.

REARANK: Reasoning Re-ranking Agent via Reinforcement Learning RankZephyr: Effective and Robust Zero-Shot Listwise Reranking is a Breeze!

Reference 18

Resolution
unresolved
no resolver link, observed 2026-08-07T14:07:13.482724Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=arxiv_source observed=2026-08-07T14:07:13.482724Z digest=sha256:b249bd964bf74c0398362b1a6657e9c941e43fbb184d7b40aceb3cf04a291f74

Observation 6de707b5-b85b-4d11-96be-4848270a9941 · outbound

This paper cites Large Language Models are Effective Text Rankers with Pairwise Ranking Prompting.

REARANK: Reasoning Re-ranking Agent via Reinforcement Learning Large Language Models are Effective Text Rankers with Pairwise Ranking Prompting

Reference 19

Resolution
unresolved
no resolver link, observed 2026-08-07T14:07:13.543503Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=arxiv_source observed=2026-08-07T14:07:13.543503Z digest=sha256:4aca13423d6d2281c5541cbd3a6d2d2f31d824072c70c1f6567c5faa2ac91eb2

Observation cbc0ee9f-6c7d-45dd-ab55-c5bbc81a80f5 · outbound

This paper cites Sentence-BERT: Sentence Embeddings using Siamese BERT-Networks.

REARANK: Reasoning Re-ranking Agent via Reinforcement Learning Sentence-BERT: Sentence Embeddings using Siamese BERT-Networks

Reference 20

Resolution
unresolved
no resolver link, observed 2026-08-07T14:07:13.632045Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=arxiv_source observed=2026-08-07T14:07:13.632045Z digest=sha256:668f8d8fdf1822d724050abe637cbd5a9a7894b0faf5d920c10dd59f1a734a48

Observation 6adf4a41-c3ce-4170-938a-7925133c8d96 · outbound

This paper cites Making Monolingual Sentence Embeddings Multilingual using Knowledge Distillation.

REARANK: Reasoning Re-ranking Agent via Reinforcement Learning Making Monolingual Sentence Embeddings Multilingual using Knowledge Distillation

Reference 21

Resolution
unresolved
no resolver link, observed 2026-08-07T14:07:13.710293Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=arxiv_source observed=2026-08-07T14:07:13.710293Z digest=sha256:e1455da31c06890a90b50df79f7a0c817d591c81aab4da2b5e5af739be496387

Observation 6b27a86c-5878-447a-a20b-760e2a108768 · outbound

This paper cites an unresolved cited work.

REARANK: Reasoning Re-ranking Agent via Reinforcement Learning Unresolved cited work

Reference 22

Resolution
unresolved
no resolver link, observed 2026-08-07T14:07:13.820059Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=arxiv_source observed=2026-08-07T14:07:13.820059Z digest=sha256:2798ecf087aabef69d3748f339a1d75400a574b523d2014fd0cb6d896646caa0

Observation df95bbe0-19a8-4339-a387-142647be3a9f · outbound

This paper cites Improving Passage Retrieval with Zero-Shot Question Generation.

REARANK: Reasoning Re-ranking Agent via Reinforcement Learning Improving Passage Retrieval with Zero-Shot Question Generation

Reference 23

Resolution
unresolved
no resolver link, observed 2026-08-07T14:07:13.912679Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=arxiv_source observed=2026-08-07T14:07:13.912679Z digest=sha256:87a58a2baff8c6f54e206e0023a8dab82a5ba17ac35ad24fc9ab1e3ae9058c08

Observation 0296164c-0b35-4e30-9a80-89f529fd4188 · outbound

This paper cites High-Dimensional Continuous Control Using Generalized Advantage Estimation.

REARANK: Reasoning Re-ranking Agent via Reinforcement Learning High-Dimensional Continuous Control Using Generalized Advantage Estimation

Reference 24

Resolution
unresolved
no resolver link, observed 2026-08-07T14:07:14.028720Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=arxiv_source observed=2026-08-07T14:07:14.028720Z digest=sha256:c14613d9b0bf099feaf147d7272e3b9f5aad4183639a3851b24303e36d3e32be

Observation 103375a3-cf07-496d-bc5b-940c4656a681 · outbound

This paper cites DeepSeekMath: Pushing the Limits of Mathematical Reasoning in Open Language Models.

REARANK: Reasoning Re-ranking Agent via Reinforcement Learning DeepSeekMath: Pushing the Limits of Mathematical Reasoning in Open Language Models

Reference 25

Resolution
unresolved
no resolver link, observed 2026-08-07T14:07:14.134085Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=arxiv_source observed=2026-08-07T14:07:14.134085Z digest=sha256:bfe9da8545362ab52e8dec025e204890694e005908e7746b4ee0345d0602340f

Observation e59a1758-8aed-4e56-92bc-2bbd02c4d1f6 · outbound

This paper cites HybridFlow: A Flexible and Efficient RLHF Framework.

REARANK: Reasoning Re-ranking Agent via Reinforcement Learning HybridFlow: A Flexible and Efficient RLHF Framework

Reference 26

Resolution
unresolved
no resolver link, observed 2026-08-07T14:07:14.250669Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=arxiv_source observed=2026-08-07T14:07:14.250669Z digest=sha256:97225433f044a8eebff412fce1cdcd00b5b59463306de3217807ba9e452fb786

Observation 3608c238-937c-4e7d-85e2-0c785f42a213 · outbound

This paper cites BRIGHT: A Realistic and Challenging Benchmark for Reasoning-Intensive Retrieval.

REARANK: Reasoning Re-ranking Agent via Reinforcement Learning BRIGHT: A Realistic and Challenging Benchmark for Reasoning-Intensive Retrieval

Reference 27

Resolution
unresolved
no resolver link, observed 2026-08-07T14:07:14.344080Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=arxiv_source observed=2026-08-07T14:07:14.344080Z digest=sha256:1787b976e9bdb71f6c5a7cd55482385127eb1d027c25497a1024c5a6370d1c3e

Observation a60c737a-9a62-4961-a1bb-ca5ad58ffc21 · outbound

This paper cites Is ChatGPT Good at Search? Investigating Large Language Models as Re-Ranking Agents.

REARANK: Reasoning Re-ranking Agent via Reinforcement Learning Is ChatGPT Good at Search? Investigating Large Language Models as Re-Ranking Agents

Reference 28

Resolution
unresolved
no resolver link, observed 2026-08-07T14:07:14.431147Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=arxiv_source observed=2026-08-07T14:07:14.431147Z digest=sha256:cdbbbb1c5e60ef27562e1ee0d84616627de748ac06d76c9efb81571aa006718c

Observation becac842-21d4-47cc-a338-ae3d3902620a · outbound

This paper cites BEIR: A Heterogenous Benchmark for Zero-shot Evaluation of Information Retrieval Models.

REARANK: Reasoning Re-ranking Agent via Reinforcement Learning BEIR: A Heterogenous Benchmark for Zero-shot Evaluation of Information Retrieval Models

Reference 29

Resolution
unresolved
no resolver link, observed 2026-08-07T14:07:14.526870Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=arxiv_source observed=2026-08-07T14:07:14.526870Z digest=sha256:62a0b4b44d530cf633145e07bf9c964756983fac323e8f91c4619d51fc9c8727

Observation fda85731-37e3-4a93-acdc-381f04a3d1db · outbound

This paper cites an unresolved cited work.

REARANK: Reasoning Re-ranking Agent via Reinforcement Learning Unresolved cited work

Reference 30

Resolution
unresolved
raw_fallback, observed 2026-08-07T14:07:17.100374Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.

source=arxiv_source observed=2026-08-07T14:07:14.614063Z digest=sha256:7e1aa1ed0186d7d28d3ae96c904452b1f1b63c12320f2fed624bb0bc24a3e1c3

Observation ea2088e5-e1a7-40ac-a035-46f613437a04 · outbound

This paper cites Self-Consistency Improves Chain of Thought Reasoning in Language Models.

REARANK: Reasoning Re-ranking Agent via Reinforcement Learning Self-Consistency Improves Chain of Thought Reasoning in Language Models

Reference 31

Resolution
unresolved
no resolver link, observed 2026-08-07T14:07:14.696818Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=arxiv_source observed=2026-08-07T14:07:14.696818Z digest=sha256:d3e160143667568a4dffca28a1aa8f2a5d1bc69649aaebcf86ffb1547dfa378e

Observation f0ac9cea-bce0-49d1-9bde-c1bcddb7f672 · outbound

This paper cites Emergent Abilities of Large Language Models.

REARANK: Reasoning Re-ranking Agent via Reinforcement Learning Emergent Abilities of Large Language Models

Reference 32

Resolution
unresolved
no resolver link, observed 2026-08-07T14:07:14.782602Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=arxiv_source observed=2026-08-07T14:07:14.782602Z digest=sha256:5be35e49459a9f8a0a7404cce65095d6f6653e7be3fe00ac9184000f13f011cc

Observation 501bf601-8980-4164-ab27-58d4b8670a56 · outbound

This paper cites an unresolved cited work.

REARANK: Reasoning Re-ranking Agent via Reinforcement Learning Unresolved cited work

Reference 33

Resolution
unresolved
no resolver link, observed 2026-08-07T14:07:14.862808Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=arxiv_source observed=2026-08-07T14:07:14.862808Z digest=sha256:9d7bf9aed7bdab1a81274070192b889274dd9474448569b1e9ed29c32c6325a5

Observation 56ca47ee-e6b4-4438-bff4-72819e86f1c6 · outbound

This paper cites Approximate Nearest Neighbor Negative Contrastive Learning for Dense Text Retrieval.

REARANK: Reasoning Re-ranking Agent via Reinforcement Learning Approximate Nearest Neighbor Negative Contrastive Learning for Dense Text Retrieval

Reference 34

Resolution
unresolved
no resolver link, observed 2026-08-07T14:07:14.938648Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=arxiv_source observed=2026-08-07T14:07:14.938648Z digest=sha256:b2f48bbad358b474b2dd72e9ed3d6e8a0614b79aa89fe6ef450acdff0bc3949c

Observation 47b725ec-579a-41bf-9a7f-93cddda09935 · outbound

This paper cites Qwen3 Technical Report.

REARANK: Reasoning Re-ranking Agent via Reinforcement Learning Qwen3 Technical Report

Reference 35

Resolution
unresolved
no resolver link, observed 2026-08-07T14:07:15.031918Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=arxiv_source observed=2026-08-07T14:07:15.031918Z digest=sha256:4ef734c58276473fd8f0fd674d93338ee355a06a21ce0b6d353902654013cb64

Observation 9b5abaf1-5858-4275-9b24-27f187242f37 · outbound

This paper cites Qwen2.5 Technical Report.

REARANK: Reasoning Re-ranking Agent via Reinforcement Learning Qwen2.5 Technical Report

Reference 36

Resolution
unresolved
no resolver link, observed 2026-08-07T14:07:15.119898Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=arxiv_source observed=2026-08-07T14:07:15.119898Z digest=sha256:319ebc90184e10fd88a17e87b5abdc971ab8d6bc76edf0d6ad08a9a96b7839e6

Observation aed25547-7cdf-423d-a46d-6f5ddd45e1d0 · outbound

This paper cites LIMO: Less is More for Reasoning.

REARANK: Reasoning Re-ranking Agent via Reinforcement Learning LIMO: Less is More for Reasoning

Reference 37

Resolution
unresolved
no resolver link, observed 2026-08-07T14:07:15.204385Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=arxiv_source observed=2026-08-07T14:07:15.204385Z digest=sha256:0ae2a716d837e0bc5b40cb7ef30c7350c8de7768a33d11fb62dca51c62087cac

Observation 68e4fece-e2f6-47de-80b8-99a6a2635ef0 · outbound

This paper cites an unresolved cited work.

REARANK: Reasoning Re-ranking Agent via Reinforcement Learning Unresolved cited work

Reference 38

Resolution
unresolved
raw_fallback, observed 2026-08-07T14:07:16.945437Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.

source=arxiv_source observed=2026-08-07T14:07:15.268427Z digest=sha256:6f979cb1ca286afdcea8081111e14093184cec1f59b0a8af1767ae624ae83d73

Observation e0e7d205-670b-414d-9dc3-fd0d33be3fa2 · outbound

This paper cites MoqaGPT : Zero-Shot Multi-modal Open-domain Question Answering with Large Language Model.

REARANK: Reasoning Re-ranking Agent via Reinforcement Learning MoqaGPT : Zero-Shot Multi-modal Open-domain Question Answering with Large Language Model

Reference 39

Resolution
unresolved
no resolver link, observed 2026-08-07T14:07:15.313276Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=arxiv_source observed=2026-08-07T14:07:15.313276Z digest=sha256:afefdef912ce0a114ff73ae2f75a42a3f3acfdecaa6f3b74ca12f991f69c8fb0

Observation 0d263f1a-8584-4870-8589-6f015d4fab51 · outbound

This paper cites Exploring the Best Practices of Query Expansion with Large Language Models.

REARANK: Reasoning Re-ranking Agent via Reinforcement Learning Exploring the Best Practices of Query Expansion with Large Language Models

Reference 40

Resolution
unresolved
no resolver link, observed 2026-08-07T14:07:15.431975Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=arxiv_source observed=2026-08-07T14:07:15.431975Z digest=sha256:63fc68df12fe544eb4faf64073c9561cd284a2dd4bc7b2e5dcff8eac7a94adf7

Observation b3bd474b-6d74-4e3b-b6d4-ce42b5804e26 · outbound

This paper cites Assessing and Learning Alignment of Unimodal Vision and Language Models.

REARANK: Reasoning Re-ranking Agent via Reinforcement Learning Assessing and Learning Alignment of Unimodal Vision and Language Models

Reference 41

Resolution
verified exact
local_arxiv, observed 2026-08-07T14:07:16.104172Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.

source=arxiv_source observed=2026-08-07T14:07:15.516659Z digest=sha256:2ade2a5d0b4f04fec849d4f1ac853f42ee8ad72c381b4141e7f062b933af8081

Observation 9a046267-0fb6-4f94-9061-a14fe4bd8d06 · outbound

This paper cites Rank-R1: Enhancing Reasoning in LLM-based Document Rerankers via Reinforcement Learning.

REARANK: Reasoning Re-ranking Agent via Reinforcement Learning Rank-R1: Enhancing Reasoning in LLM-based Document Rerankers via Reinforcement Learning

Reference 42

Resolution
unresolved
no resolver link, observed 2026-08-07T14:07:15.608784Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=arxiv_source observed=2026-08-07T14:07:15.608784Z digest=sha256:1e5e5820d5b54bf43f9ac27cbc8fdb84b6e31d18676db3d2c8be45604a9524b2

Observation e8854213-5ce7-4bcc-9724-c58a87ecd53d · outbound

This paper cites an unresolved cited work.

REARANK: Reasoning Re-ranking Agent via Reinforcement Learning Unresolved cited work

Reference 43

Resolution
unresolved
no resolver link, observed 2026-08-07T14:07:15.689635Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=arxiv_source observed=2026-08-07T14:07:15.689635Z digest=sha256:dc8f6c064ea76375322d6499c75ec1223ddcbbe0d6b37ce324920cbb9c1ad3f5

Observation 099797bc-7ed4-4034-9836-dfdaf626f65b · outbound

This paper cites online" 'onlinestring :=.

REARANK: Reasoning Re-ranking Agent via Reinforcement Learning online" 'onlinestring :=

Reference 44

Resolution
unresolved
no resolver link, observed 2026-08-07T14:07:15.782529Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=arxiv_source observed=2026-08-07T14:07:15.782529Z digest=sha256:a07c43341a44b4f36ed512ec13ac5b5667ca848f9dc776bdd2cc16485735abd1

Observation e2ae1378-e3c4-43df-9280-daffdc4c725b · outbound

This paper cites write newline.

REARANK: Reasoning Re-ranking Agent via Reinforcement Learning write newline

Reference 45

Resolution
unresolved
no resolver link, observed 2026-08-07T14:07:15.898573Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=arxiv_source observed=2026-08-07T14:07:15.898573Z digest=sha256:5076febc4ae6512afd0cb48fd829343de0865fbbdceb4ea035a7d4435f0f5e3d

Pith citing papers

Observation 904dc180-4f69-4252-a47e-f5f07c2258ee · inbound

A Vision for Geo-Temporal Deep Research Systems: Towards Comprehensive, Transparent, and Reproducible Geo-Temporal Information Synthesis cites this paper.

A Vision for Geo-Temporal Deep Research Systems: Towards Comprehensive, Transparent, and Reproducible Geo-Temporal Information Synthesis REARANK: Reasoning Re-ranking Agent via Reinforcement Learning

Reference 54

Resolution
unresolved
no resolver link, observed 2026-08-07T00:22:24.214754Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-07T00:22:24.214754Z digest=sha256:b925fd20e04aab5d98f56d5cf18aaa67f8c32553616cac78c9c1022f8d12d276

Observation 65b7558d-6e21-4157-a9f1-ddb5a96089ed · inbound

CogniSQL-R1-Zero: Lightweight Reinforced Reasoning for Efficient SQL Generation cites this paper.

CogniSQL-R1-Zero: Lightweight Reinforced Reasoning for Efficient SQL Generation REARANK: Reasoning Re-ranking Agent via Reinforcement Learning

Reference 16

Resolution
unresolved
no resolver link, observed 2026-08-06T19:18:36.607918Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-06T19:18:36.607918Z digest=sha256:c79d80fab67f168d2e765e7a8e76a32f5acb5c2a51c1d7a72675bada921aed0b

Observation 9cdb853f-3249-462e-abae-dd7dff889d00 · inbound

ReasonRank: Empowering Passage Ranking with Strong Reasoning Ability cites this paper.

ReasonRank: Empowering Passage Ranking with Strong Reasoning Ability REARANK: Reasoning Re-ranking Agent via Reinforcement Learning

Reference 5

Resolution
verified exact
arxiv_id, observed 2026-05-18T23:56:55.111132Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.

source=pdf_text observed=2026-05-18T23:54:11.058239Z digest=sha256:f02091978dd3c4e7e6b472c44296a97e555a53041a670d42469edcf54f15583b

Observation 5d987b17-618b-43bd-bf77-0d94176ecfcd · inbound

ERank: Fusing Supervised Fine-Tuning and Reinforcement Learning for Effective and Efficient Text Reranking cites this paper.

ERank: Fusing Supervised Fine-Tuning and Reinforcement Learning for Effective and Efficient Text Reranking REARANK: Reasoning Re-ranking Agent via Reinforcement Learning

Reference 42

Resolution
unresolved
no resolver link, observed 2026-08-05T13:36:40.296461Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=arxiv_source observed=2026-08-05T13:36:40.296461Z digest=sha256:06ea4b3f64ce9f988d23b2100d4049e736cbe10d36a3790207a6b98e6571c9a6

Observation b3de92ea-3f81-4977-b480-d990b3e990a0 · inbound

Rich-Media Re-Ranker: A User Satisfaction-Driven LLM Re-ranking Framework for Rich-Media Search cites this paper.

Rich-Media Re-Ranker: A User Satisfaction-Driven LLM Re-ranking Framework for Rich-Media Search REARANK: Reasoning Re-ranking Agent via Reinforcement Learning

Reference 40

Resolution
verified exact
arxiv_id, observed 2026-05-16T07:30:44.234572Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.

source=pdf_text observed=2026-05-16T07:30:28.303573Z digest=sha256:342f965118fa9acde449bf5caa78476e8fd93043987828f5c5943ff71d75283c

Observation 28c9a35a-f2fc-452b-93f3-42fa969fb3b4 · inbound

MemSifter: Offloading LLM Memory Retrieval via Outcome-Driven Proxy Reasoning cites this paper.

MemSifter: Offloading LLM Memory Retrieval via Outcome-Driven Proxy Reasoning REARANK: Reasoning Re-ranking Agent via Reinforcement Learning

Reference 66

Resolution
unresolved
no resolver link, observed 2026-08-02T19:23:18.186586Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-02T19:23:18.186586Z digest=sha256:8788e39f9e3f4c10fc4105123fdc2a330490a93fec07b3d3b85a948c90f349ab

Observation 9e5b552c-b100-400b-a8f4-79f2f8db55a4 · inbound

Optimizing RAG Rerankers with LLM Feedback via Reinforcement Learning cites this paper.

Optimizing RAG Rerankers with LLM Feedback via Reinforcement Learning REARANK: Reasoning Re-ranking Agent via Reinforcement Learning

Reference 53

Resolution
unresolved
no resolver link, observed 2026-07-13T13:59:01.287449Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=arxiv_source observed=2026-07-13T13:59:01.287449Z digest=sha256:198325a5deb172a04e086827e5e7a49802f10eb625dcbe39ee1d6cbc8ec7bd06