{"as_of":"2026-08-10T04:19:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:9ef244b296aa49004078bf72474d33dd8aedd29703702de484315976deea0c94","coverage":[{"denominator":44,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":44,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-07T14:07:15.898573Z","state":"measured"},{"denominator":51,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":51,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-09T06:31:02.800959+00:00","state":"measured"},{"denominator":7,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":7,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-07T00:22:24.214754Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"arxiv_reference","source_observed_at":"2026-05-18T23:56:55.107569Z","state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2505.20046","last_updated":"2025-05-26T14:31:48Z","snapshot_observed_at":"2026-08-08T21:13:42.536838Z","submitted_at":"2025-05-26T14:31:48Z","title":"REARANK: Reasoning Re-ranking Agent via Reinforcement Learning","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2505.20046","snapshot_observed_at":"2026-08-07T00:22:24.214754Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2506.14345","last_updated":"2025-06-17T09:38:45Z","snapshot_observed_at":"2026-08-07T14:48:30.252463Z","submitted_at":"2025-06-17T09:38:45Z","title":"A Vision for Geo-Temporal Deep Research Systems: Towards Comprehensive, Transparent, and Reproducible Geo-Temporal Information Synthesis","version":1},"reference_index":54,"source":"pdf_text","source_observed_at":"2026-08-07T00:22:24.214754Z"},"links":{"cited_paper":"/paper/2505.20046","citing_paper":"/paper/2506.14345"},"observation_digest":"sha256:9b4fdfaea494a9711675ea020d3a2f7261939c66fb78aee08ce4feadb4ee6e90","observation_id":"904dc180-4f69-4252-a47e-f5f07c2258ee","resolution":{"observed_at":"2026-08-07T00:22:24.214754Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2505.20046","last_updated":"2025-05-26T14:31:48Z","snapshot_observed_at":"2026-08-08T21:13:42.536838Z","submitted_at":"2025-05-26T14:31:48Z","title":"REARANK: Reasoning Re-ranking Agent via Reinforcement Learning","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2505.20046","snapshot_observed_at":"2026-08-06T19:18:36.607918Z","title":"Zhang et al","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2507.06013","last_updated":"2025-07-08T14:17:07Z","snapshot_observed_at":"2026-08-07T22:57:58.555368Z","submitted_at":"2025-07-08T14:17:07Z","title":"CogniSQL-R1-Zero: Lightweight Reinforced Reasoning for Efficient SQL Generation","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-06T19:18:36.607918Z"},"links":{"cited_paper":"/paper/2505.20046","citing_paper":"/paper/2507.06013"},"observation_digest":"sha256:7700f6b67306ef0230c62e2563a182ae90100baf76df492703ffc9d976ac615d","observation_id":"65b7558d-6e21-4157-a9f1-ddb5a96089ed","resolution":{"observed_at":"2026-08-06T19:18:36.607918Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2505.20046","last_updated":"2025-05-26T14:31:48Z","snapshot_observed_at":"2026-08-08T21:13:42.536838Z","submitted_at":"2025-05-26T14:31:48Z","title":"REARANK: Reasoning Re-ranking Agent via Reinforcement Learning","version":1},"cited_work":{"arxiv_id":"2505.20046","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2505.20046","snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"CoRR, abs/2505.20046","venue":null,"work_id":"1490651e-5dec-40b8-9fad-f8e711ea4909","year":2025},"citing_paper":{"arxiv_id":"2508.07050","last_updated":"2026-04-22T03:08:54Z","snapshot_observed_at":"2026-07-06T22:10:31.258024Z","submitted_at":"2025-08-09T17:26:18Z","title":"ReasonRank: Empowering Passage Ranking with Strong Reasoning Ability","version":3},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-05-18T23:54:11.058239Z"},"links":{"cited_paper":"/paper/2505.20046","citing_paper":"/paper/2508.07050"},"observation_digest":"sha256:f7504a1b35c9d628c532411c9450480a10b94f6058e537fdee4faa091ab9a1fe","observation_id":"9cdb853f-3249-462e-abae-dd7dff889d00","resolution":{"observed_at":"2026-05-18T23:56:55.111132Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2505.20046","last_updated":"2025-05-26T14:31:48Z","snapshot_observed_at":"2026-08-08T21:13:42.536838Z","submitted_at":"2025-05-26T14:31:48Z","title":"REARANK: Reasoning Re-ranking Agent via Reinforcement Learning","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2505.20046","snapshot_observed_at":"2026-08-05T13:36:40.296461Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2509.00520","last_updated":"2025-08-30T14:56:53Z","snapshot_observed_at":"2026-08-08T13:53:31.107432Z","submitted_at":"2025-08-30T14:56:53Z","title":"ERank: Fusing Supervised Fine-Tuning and Reinforcement Learning for Effective and Efficient Text Reranking","version":1},"reference_index":42,"source":"arxiv_source","source_observed_at":"2026-08-05T13:36:40.296461Z"},"links":{"cited_paper":"/paper/2505.20046","citing_paper":"/paper/2509.00520"},"observation_digest":"sha256:09dff8e8b9446aececf9137805cfbbbbdfc2e13e4c1fc4e7bba56707fc941685","observation_id":"5d987b17-618b-43bd-bf77-0d94176ecfcd","resolution":{"observed_at":"2026-08-05T13:36:40.296461Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2505.20046","last_updated":"2025-05-26T14:31:48Z","snapshot_observed_at":"2026-08-08T21:13:42.536838Z","submitted_at":"2025-05-26T14:31:48Z","title":"REARANK: Reasoning Re-ranking Agent via Reinforcement Learning","version":1},"cited_work":{"arxiv_id":"2505.20046","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2505.20046","snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"CoRR, abs/2505.20046","venue":null,"work_id":"1490651e-5dec-40b8-9fad-f8e711ea4909","year":2025},"citing_paper":{"arxiv_id":"2602.05408","last_updated":"2026-05-13T14:11:17Z","snapshot_observed_at":"2026-08-06T12:20:47.690510Z","submitted_at":"2026-02-05T07:45:42Z","title":"Rich-Media Re-Ranker: A User Satisfaction-Driven LLM Re-ranking Framework for Rich-Media Search","version":2},"reference_index":40,"source":"pdf_text","source_observed_at":"2026-05-16T07:30:28.303573Z"},"links":{"cited_paper":"/paper/2505.20046","citing_paper":"/paper/2602.05408"},"observation_digest":"sha256:43d100098ef60d715ae51f5c9deb86e2ab69e45c14e125bff57292a644513ef3","observation_id":"b3de92ea-3f81-4977-b480-d990b3e990a0","resolution":{"observed_at":"2026-05-16T07:30:44.234572Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2505.20046","last_updated":"2025-05-26T14:31:48Z","snapshot_observed_at":"2026-08-08T21:13:42.536838Z","submitted_at":"2025-05-26T14:31:48Z","title":"REARANK: Reasoning Re-ranking Agent via Reinforcement Learning","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2505.20046","snapshot_observed_at":"2026-08-02T19:23:18.186586Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2603.03379","last_updated":"2026-06-21T09:02:19Z","snapshot_observed_at":"2026-08-02T19:23:16.898744Z","submitted_at":"2026-03-03T02:57:38Z","title":"MemSifter: Offloading LLM Memory Retrieval via Outcome-Driven Proxy Reasoning","version":2},"reference_index":66,"source":"pdf_text","source_observed_at":"2026-08-02T19:23:18.186586Z"},"links":{"cited_paper":"/paper/2505.20046","citing_paper":"/paper/2603.03379"},"observation_digest":"sha256:f43884c5a04ce7515a29ab92f1682c0068b6f42c20b36bf7aa54d2c13d733beb","observation_id":"28c9a35a-f2fc-452b-93f3-42fa969fb3b4","resolution":{"observed_at":"2026-08-02T19:23:18.186586Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2505.20046","last_updated":"2025-05-26T14:31:48Z","snapshot_observed_at":"2026-08-08T21:13:42.536838Z","submitted_at":"2025-05-26T14:31:48Z","title":"REARANK: Reasoning Re-ranking Agent via Reinforcement Learning","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2505.20046","snapshot_observed_at":"2026-07-13T13:59:01.287449Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2604.02091","last_updated":"2026-07-02T17:08:51Z","snapshot_observed_at":"2026-08-09T18:07:23.071685Z","submitted_at":"2026-04-02T14:19:47Z","title":"Optimizing RAG Rerankers with LLM Feedback via Reinforcement Learning","version":2},"reference_index":53,"source":"arxiv_source","source_observed_at":"2026-07-13T13:59:01.287449Z"},"links":{"cited_paper":"/paper/2505.20046","citing_paper":"/paper/2604.02091"},"observation_digest":"sha256:5c1a9c299719e33617b08257ee0e8a6e24a52ce73d90554939ce2d76da1ccde8","observation_id":"9e5b552c-b100-400b-a8f4-79f2f8db55a4","resolution":{"observed_at":"2026-07-13T13:59:01.287449Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"links":{"evidence":"/evidence","html":"/paper/2505.20046/citation-record","integrity":"/paper/2505.20046/integrity","json":"/paper/2505.20046/citation-record.json","paper":"/paper/2505.20046"},"outbound":[{"citation":{"cited_paper":{"arxiv_id":"2303.08774","last_updated":"2024-03-04T06:01:33Z","snapshot_observed_at":"2026-08-07T07:30:12.213965Z","submitted_at":"2023-03-15T17:15:04Z","title":"GPT-4 Technical Report","version":6},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2303.08774","snapshot_observed_at":"2026-08-07T14:07:11.863636Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.20046","last_updated":"2025-05-26T14:31:48Z","snapshot_observed_at":"2026-08-08T21:13:42.536838Z","submitted_at":"2025-05-26T14:31:48Z","title":"REARANK: Reasoning Re-ranking Agent via Reinforcement Learning","version":1},"reference_index":1,"source":"arxiv_source","source_observed_at":"2026-08-07T14:07:11.863636Z"},"links":{"cited_paper":"/paper/2303.08774","citing_paper":"/paper/2505.20046"},"observation_digest":"sha256:b85a3710654d937030f79d77b12211979c80e45f2c764b3ea7ae7afcbe0f5267","observation_id":"e1c5c600-b5ad-4632-bbbb-6769888ab87c","resolution":{"observed_at":"2026-08-07T14:07:11.863636Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2404.05961","last_updated":"2024-08-21T22:46:05Z","snapshot_observed_at":"2026-08-08T03:53:14.177644Z","submitted_at":"2024-04-09T02:51:05Z","title":"LLM2Vec: Large Language Models Are Secretly Powerful Text Encoders","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2404.05961","snapshot_observed_at":"2026-08-07T14:07:11.928833Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.20046","last_updated":"2025-05-26T14:31:48Z","snapshot_observed_at":"2026-08-08T21:13:42.536838Z","submitted_at":"2025-05-26T14:31:48Z","title":"REARANK: Reasoning Re-ranking Agent via Reinforcement Learning","version":1},"reference_index":2,"source":"arxiv_source","source_observed_at":"2026-08-07T14:07:11.928833Z"},"links":{"cited_paper":"/paper/2404.05961","citing_paper":"/paper/2505.20046"},"observation_digest":"sha256:59af81fc32eb454ef6ecbc368a76c1194fa773dbfd499730eb27350e5eaf0657","observation_id":"75c105d8-9080-4f43-b9eb-44f8cfd06f79","resolution":{"observed_at":"2026-08-07T14:07:11.928833Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:07:12.013949Z","title":null,"venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2505.20046","last_updated":"2025-05-26T14:31:48Z","snapshot_observed_at":"2026-08-08T21:13:42.536838Z","submitted_at":"2025-05-26T14:31:48Z","title":"REARANK: Reasoning Re-ranking Agent via Reinforcement Learning","version":1},"reference_index":3,"source":"arxiv_source","source_observed_at":"2026-08-07T14:07:12.013949Z"},"links":{"citing_paper":"/paper/2505.20046"},"observation_digest":"sha256:e6a58e06855456c201735a97233d60f9bff7d3b4c20e4ca1c4ee179533423cee","observation_id":"77130b62-65b6-4a3f-9646-9942139c28d1","resolution":{"observed_at":"2026-08-07T14:07:12.013949Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2003.07820","last_updated":"2020-03-18T16:56:56Z","snapshot_observed_at":"2026-07-06T09:05:23.015957Z","submitted_at":"2020-03-17T17:12:36Z","title":"Overview of the TREC 2019 deep learning track","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2003.07820","snapshot_observed_at":"2026-08-07T14:07:12.186322Z","title":null,"venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2505.20046","last_updated":"2025-05-26T14:31:48Z","snapshot_observed_at":"2026-08-08T21:13:42.536838Z","submitted_at":"2025-05-26T14:31:48Z","title":"REARANK: Reasoning Re-ranking Agent via Reinforcement Learning","version":1},"reference_index":5,"source":"arxiv_source","source_observed_at":"2026-08-07T14:07:12.186322Z"},"links":{"cited_paper":"/paper/2003.07820","citing_paper":"/paper/2505.20046"},"observation_digest":"sha256:72b236e5495b14262e7fc78a9da51116b04d29705e871cd9807f4a1baa18e03a","observation_id":"0eca5c43-d392-4839-83b5-154c336b9c1e","resolution":{"observed_at":"2026-08-07T14:07:12.186322Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:07:12.278805Z","title":null,"venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2505.20046","last_updated":"2025-05-26T14:31:48Z","snapshot_observed_at":"2026-08-08T21:13:42.536838Z","submitted_at":"2025-05-26T14:31:48Z","title":"REARANK: Reasoning Re-ranking Agent via Reinforcement Learning","version":1},"reference_index":6,"source":"arxiv_source","source_observed_at":"2026-08-07T14:07:12.278805Z"},"links":{"citing_paper":"/paper/2505.20046"},"observation_digest":"sha256:5e0b838a3f043399639989485d957291f244e5e9268319740989e76270c0a41a","observation_id":"4f780dec-d5f7-4ec3-88cf-b6f21387737d","resolution":{"observed_at":"2026-08-07T14:07:12.278805Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:07:17.438171Z","title":null,"venue":null,"work_id":"fdfecece-7fe8-4731-8af4-4d1485bb5292","year":2004},"citing_paper":{"arxiv_id":"2505.20046","last_updated":"2025-05-26T14:31:48Z","snapshot_observed_at":"2026-08-08T21:13:42.536838Z","submitted_at":"2025-05-26T14:31:48Z","title":"REARANK: Reasoning Re-ranking Agent via Reinforcement Learning","version":1},"reference_index":7,"source":"arxiv_source","source_observed_at":"2026-08-07T14:07:12.333196Z"},"links":{"citing_paper":"/paper/2505.20046"},"observation_digest":"sha256:de76f8ac89ef39684f6d80fb1f2d07f201916e0350e57b772964f6cf06d492d1","observation_id":"1819c3a8-98cd-4df3-884f-2a4c8a9a5426","resolution":{"observed_at":"2026-08-07T14:07:17.498898Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2501.12948","last_updated":"2026-01-04T03:57:36Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-01-22T15:19:35Z","title":"DeepSeek-R1: Incentivizing Reasoning Capability in LLMs via Reinforcement Learning","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2501.12948","snapshot_observed_at":"2026-08-07T14:07:12.431132Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2505.20046","last_updated":"2025-05-26T14:31:48Z","snapshot_observed_at":"2026-08-08T21:13:42.536838Z","submitted_at":"2025-05-26T14:31:48Z","title":"REARANK: Reasoning Re-ranking Agent via Reinforcement Learning","version":1},"reference_index":8,"source":"arxiv_source","source_observed_at":"2026-08-07T14:07:12.431132Z"},"links":{"cited_paper":"/paper/2501.12948","citing_paper":"/paper/2505.20046"},"observation_digest":"sha256:384b17d50e62db26e01dbf708fca7557c099aa845bb44f3bb581a27f0dadbecd","observation_id":"8f5bad58-10d1-4446-b8cc-811dc36790f4","resolution":{"observed_at":"2026-08-07T14:07:12.431132Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:07:12.554615Z","title":null,"venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2505.20046","last_updated":"2025-05-26T14:31:48Z","snapshot_observed_at":"2026-08-08T21:13:42.536838Z","submitted_at":"2025-05-26T14:31:48Z","title":"REARANK: Reasoning Re-ranking Agent via Reinforcement Learning","version":1},"reference_index":9,"source":"arxiv_source","source_observed_at":"2026-08-07T14:07:12.554615Z"},"links":{"citing_paper":"/paper/2505.20046"},"observation_digest":"sha256:35330dd3d726194f3914679d1399107862d5bfd3a50b29e69b81bfe47fb2b3f2","observation_id":"8f76fa81-6b56-4342-95fa-5de23e6af88d","resolution":{"observed_at":"2026-08-07T14:07:12.554615Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2405.17428","last_updated":"2025-02-25T00:35:18Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-05-27T17:59:45Z","title":"NV-Embed: Improved Techniques for Training LLMs as Generalist Embedding Models","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2405.17428","snapshot_observed_at":"2026-08-07T14:07:12.642594Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.20046","last_updated":"2025-05-26T14:31:48Z","snapshot_observed_at":"2026-08-08T21:13:42.536838Z","submitted_at":"2025-05-26T14:31:48Z","title":"REARANK: Reasoning Re-ranking Agent via Reinforcement Learning","version":1},"reference_index":10,"source":"arxiv_source","source_observed_at":"2026-08-07T14:07:12.642594Z"},"links":{"cited_paper":"/paper/2405.17428","citing_paper":"/paper/2505.20046"},"observation_digest":"sha256:afc28ce1d0e92182e64eee735da02846074ad1e907db43f00f1c6ddd9f15fac5","observation_id":"5ebc3e12-4cd2-4b97-a5ce-3c9056502b12","resolution":{"observed_at":"2026-08-07T14:07:12.642594Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:07:12.728412Z","title":"u ttler, Mike Lewis, Wen-tau Yih, Tim Rockt \\","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2505.20046","last_updated":"2025-05-26T14:31:48Z","snapshot_observed_at":"2026-08-08T21:13:42.536838Z","submitted_at":"2025-05-26T14:31:48Z","title":"REARANK: Reasoning Re-ranking Agent via Reinforcement Learning","version":1},"reference_index":11,"source":"arxiv_source","source_observed_at":"2026-08-07T14:07:12.728412Z"},"links":{"citing_paper":"/paper/2505.20046"},"observation_digest":"sha256:873e38c2402d9b2c8dabfe2ca7bf1da7050975fad6d70c6ded4bbfb7c913480f","observation_id":"1cb00cf5-5414-4f55-919f-483caf7995b2","resolution":{"observed_at":"2026-08-07T14:07:12.728412Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2211.09110","last_updated":"2023-10-01T21:44:23Z","snapshot_observed_at":"2026-08-01T19:14:56.803459Z","submitted_at":"2022-11-16T18:51:34Z","title":"Holistic Evaluation of Language Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2211.09110","snapshot_observed_at":"2026-08-07T14:07:12.880824Z","title":null,"venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2505.20046","last_updated":"2025-05-26T14:31:48Z","snapshot_observed_at":"2026-08-08T21:13:42.536838Z","submitted_at":"2025-05-26T14:31:48Z","title":"REARANK: Reasoning Re-ranking Agent via Reinforcement Learning","version":1},"reference_index":12,"source":"arxiv_source","source_observed_at":"2026-08-07T14:07:12.880824Z"},"links":{"cited_paper":"/paper/2211.09110","citing_paper":"/paper/2505.20046"},"observation_digest":"sha256:115f3fbb3fd9c5dbf22f477645ed17a54d278ceddc696669196ea9f981ef2295","observation_id":"2fa802e0-ff55-4d3e-a7f4-23a95b019711","resolution":{"observed_at":"2026-08-07T14:07:12.880824Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:07:17.310070Z","title":null,"venue":null,"work_id":"50b67168-07fe-40e5-8c93-26d0aac7f998","year":2024},"citing_paper":{"arxiv_id":"2505.20046","last_updated":"2025-05-26T14:31:48Z","snapshot_observed_at":"2026-08-08T21:13:42.536838Z","submitted_at":"2025-05-26T14:31:48Z","title":"REARANK: Reasoning Re-ranking Agent via Reinforcement Learning","version":1},"reference_index":13,"source":"arxiv_source","source_observed_at":"2026-08-07T14:07:12.949364Z"},"links":{"citing_paper":"/paper/2505.20046"},"observation_digest":"sha256:d80661e036c5e54f70c4ca07b7c60e0a7ffaec834722e91aa00178a47ec683ff","observation_id":"d4379efc-d361-4030-9224-85a752862fcf","resolution":{"observed_at":"2026-08-07T14:07:17.371527Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:07:17.166071Z","title":null,"venue":null,"work_id":"84d9759b-cd19-4e7d-be06-54bd34fee788","year":2024},"citing_paper":{"arxiv_id":"2505.20046","last_updated":"2025-05-26T14:31:48Z","snapshot_observed_at":"2026-08-08T21:13:42.536838Z","submitted_at":"2025-05-26T14:31:48Z","title":"REARANK: Reasoning Re-ranking Agent via Reinforcement Learning","version":1},"reference_index":14,"source":"arxiv_source","source_observed_at":"2026-08-07T14:07:13.030726Z"},"links":{"citing_paper":"/paper/2505.20046"},"observation_digest":"sha256:bd102337de24f1349478299d957659dd384db0d4ebbaf0c2730714cf6c9db538","observation_id":"019d401d-c136-41a9-9146-769b6c9d9e0d","resolution":{"observed_at":"2026-08-07T14:07:17.236872Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2305.02156","last_updated":"2023-05-03T14:45:34Z","snapshot_observed_at":"2026-08-07T22:52:50.160521Z","submitted_at":"2023-05-03T14:45:34Z","title":"Zero-Shot Listwise Document Reranking with a Large Language Model","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2305.02156","snapshot_observed_at":"2026-08-07T14:07:13.130568Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.20046","last_updated":"2025-05-26T14:31:48Z","snapshot_observed_at":"2026-08-08T21:13:42.536838Z","submitted_at":"2025-05-26T14:31:48Z","title":"REARANK: Reasoning Re-ranking Agent via Reinforcement Learning","version":1},"reference_index":15,"source":"arxiv_source","source_observed_at":"2026-08-07T14:07:13.130568Z"},"links":{"cited_paper":"/paper/2305.02156","citing_paper":"/paper/2505.20046"},"observation_digest":"sha256:25c0e4eb01199c1e055cf72047c15b39f85e62fe3bccff9bb7941669a5ef215c","observation_id":"06b560b1-34e2-47b0-aea1-c199707b655e","resolution":{"observed_at":"2026-08-07T14:07:13.130568Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:07:13.230177Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2505.20046","last_updated":"2025-05-26T14:31:48Z","snapshot_observed_at":"2026-08-08T21:13:42.536838Z","submitted_at":"2025-05-26T14:31:48Z","title":"REARANK: Reasoning Re-ranking Agent via Reinforcement Learning","version":1},"reference_index":16,"source":"arxiv_source","source_observed_at":"2026-08-07T14:07:13.230177Z"},"links":{"citing_paper":"/paper/2505.20046"},"observation_digest":"sha256:3ed1e5b7f08a0d60165b18e10fd419e898241b2d03bcd1b5c1eb57bfb2445607","observation_id":"14b0a914-6e7a-4a45-90cf-3d6ed6589b3e","resolution":{"observed_at":"2026-08-07T14:07:13.230177Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2309.15088","last_updated":"2023-09-26T17:31:57Z","snapshot_observed_at":"2026-07-06T16:23:57.143116Z","submitted_at":"2023-09-26T17:31:57Z","title":"RankVicuna: Zero-Shot Listwise Document Reranking with Open-Source Large Language Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2309.15088","snapshot_observed_at":"2026-08-07T14:07:13.357576Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.20046","last_updated":"2025-05-26T14:31:48Z","snapshot_observed_at":"2026-08-08T21:13:42.536838Z","submitted_at":"2025-05-26T14:31:48Z","title":"REARANK: Reasoning Re-ranking Agent via Reinforcement Learning","version":1},"reference_index":17,"source":"arxiv_source","source_observed_at":"2026-08-07T14:07:13.357576Z"},"links":{"cited_paper":"/paper/2309.15088","citing_paper":"/paper/2505.20046"},"observation_digest":"sha256:12e0240e362dfaf1ce27ad75d2b81c0f41d7293ad69b411b075d9c15cb6b7f44","observation_id":"eb040adb-49b5-44bd-9cbd-665633845071","resolution":{"observed_at":"2026-08-07T14:07:13.357576Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2312.02724","last_updated":"2023-12-05T12:39:00Z","snapshot_observed_at":"2026-08-09T14:11:36.092661Z","submitted_at":"2023-12-05T12:39:00Z","title":"RankZephyr: Effective and Robust Zero-Shot Listwise Reranking is a Breeze!","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2312.02724","snapshot_observed_at":"2026-08-07T14:07:13.482724Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.20046","last_updated":"2025-05-26T14:31:48Z","snapshot_observed_at":"2026-08-08T21:13:42.536838Z","submitted_at":"2025-05-26T14:31:48Z","title":"REARANK: Reasoning Re-ranking Agent via Reinforcement Learning","version":1},"reference_index":18,"source":"arxiv_source","source_observed_at":"2026-08-07T14:07:13.482724Z"},"links":{"cited_paper":"/paper/2312.02724","citing_paper":"/paper/2505.20046"},"observation_digest":"sha256:f7955f2824c345c7f89a3c8aa675c4228289916677434e14b43bb07d4253d8c7","observation_id":"32b928cf-b0f8-40d2-96ea-82ae0738ce61","resolution":{"observed_at":"2026-08-07T14:07:13.482724Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2306.17563","last_updated":"2024-03-28T13:59:09Z","snapshot_observed_at":"2026-07-06T15:48:44.267376Z","submitted_at":"2023-06-30T11:32:25Z","title":"Large Language Models are Effective Text Rankers with Pairwise Ranking Prompting","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2306.17563","snapshot_observed_at":"2026-08-07T14:07:13.543503Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.20046","last_updated":"2025-05-26T14:31:48Z","snapshot_observed_at":"2026-08-08T21:13:42.536838Z","submitted_at":"2025-05-26T14:31:48Z","title":"REARANK: Reasoning Re-ranking Agent via Reinforcement Learning","version":1},"reference_index":19,"source":"arxiv_source","source_observed_at":"2026-08-07T14:07:13.543503Z"},"links":{"cited_paper":"/paper/2306.17563","citing_paper":"/paper/2505.20046"},"observation_digest":"sha256:aea052da02a49c65c6b3aebf63fec9405ef2846b3b3900a9f54a5a73082dcc51","observation_id":"6de707b5-b85b-4d11-96be-4848270a9941","resolution":{"observed_at":"2026-08-07T14:07:13.543503Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1908.10084","last_updated":"2019-08-27T08:50:17Z","snapshot_observed_at":"2026-07-06T08:17:05.681370Z","submitted_at":"2019-08-27T08:50:17Z","title":"Sentence-BERT: Sentence Embeddings using Siamese BERT-Networks","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1908.10084","snapshot_observed_at":"2026-08-07T14:07:13.632045Z","title":null,"venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2505.20046","last_updated":"2025-05-26T14:31:48Z","snapshot_observed_at":"2026-08-08T21:13:42.536838Z","submitted_at":"2025-05-26T14:31:48Z","title":"REARANK: Reasoning Re-ranking Agent via Reinforcement Learning","version":1},"reference_index":20,"source":"arxiv_source","source_observed_at":"2026-08-07T14:07:13.632045Z"},"links":{"cited_paper":"/paper/1908.10084","citing_paper":"/paper/2505.20046"},"observation_digest":"sha256:a3001491924b5d51c78c15f10a4649af0731618fcd1ee784a747200de7832701","observation_id":"cbc0ee9f-6c7d-45dd-ab55-c5bbc81a80f5","resolution":{"observed_at":"2026-08-07T14:07:13.632045Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2004.09813","last_updated":"2020-10-05T06:30:56Z","snapshot_observed_at":"2026-08-06T22:52:30.854160Z","submitted_at":"2020-04-21T08:20:25Z","title":"Making Monolingual Sentence Embeddings Multilingual using Knowledge Distillation","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2004.09813","snapshot_observed_at":"2026-08-07T14:07:13.710293Z","title":null,"venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2505.20046","last_updated":"2025-05-26T14:31:48Z","snapshot_observed_at":"2026-08-08T21:13:42.536838Z","submitted_at":"2025-05-26T14:31:48Z","title":"REARANK: Reasoning Re-ranking Agent via Reinforcement Learning","version":1},"reference_index":21,"source":"arxiv_source","source_observed_at":"2026-08-07T14:07:13.710293Z"},"links":{"cited_paper":"/paper/2004.09813","citing_paper":"/paper/2505.20046"},"observation_digest":"sha256:2e45afb5095e66aa57c064183cf71081066209bb13427a573ab9069ac483b7ca","observation_id":"6adf4a41-c3ce-4170-938a-7925133c8d96","resolution":{"observed_at":"2026-08-07T14:07:13.710293Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:07:13.820059Z","title":null,"venue":null,"work_id":null,"year":2009},"citing_paper":{"arxiv_id":"2505.20046","last_updated":"2025-05-26T14:31:48Z","snapshot_observed_at":"2026-08-08T21:13:42.536838Z","submitted_at":"2025-05-26T14:31:48Z","title":"REARANK: Reasoning Re-ranking Agent via Reinforcement Learning","version":1},"reference_index":22,"source":"arxiv_source","source_observed_at":"2026-08-07T14:07:13.820059Z"},"links":{"citing_paper":"/paper/2505.20046"},"observation_digest":"sha256:579ee484e82b400286db58dfbafb9328f2cf2cfbdd762fe88c4952b9208216f5","observation_id":"6b27a86c-5878-447a-a20b-760e2a108768","resolution":{"observed_at":"2026-08-07T14:07:13.820059Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2204.07496","last_updated":"2023-04-03T00:07:58Z","snapshot_observed_at":"2026-07-06T13:00:46.828547Z","submitted_at":"2022-04-15T14:51:41Z","title":"Improving Passage Retrieval with Zero-Shot Question Generation","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2204.07496","snapshot_observed_at":"2026-08-07T14:07:13.912679Z","title":null,"venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2505.20046","last_updated":"2025-05-26T14:31:48Z","snapshot_observed_at":"2026-08-08T21:13:42.536838Z","submitted_at":"2025-05-26T14:31:48Z","title":"REARANK: Reasoning Re-ranking Agent via Reinforcement Learning","version":1},"reference_index":23,"source":"arxiv_source","source_observed_at":"2026-08-07T14:07:13.912679Z"},"links":{"cited_paper":"/paper/2204.07496","citing_paper":"/paper/2505.20046"},"observation_digest":"sha256:00f22ca7d6605a97d3b740ce675bb1dd46be16741950e4e3ea12d965f966bd27","observation_id":"df95bbe0-19a8-4339-a387-142647be3a9f","resolution":{"observed_at":"2026-08-07T14:07:13.912679Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1506.02438","last_updated":"2018-10-20T18:55:07Z","snapshot_observed_at":"2026-08-09T23:04:15.431743Z","submitted_at":"2015-06-08T11:12:48Z","title":"High-Dimensional Continuous Control Using Generalized Advantage Estimation","version":6},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1506.02438","snapshot_observed_at":"2026-08-07T14:07:14.028720Z","title":null,"venue":null,"work_id":null,"year":2015},"citing_paper":{"arxiv_id":"2505.20046","last_updated":"2025-05-26T14:31:48Z","snapshot_observed_at":"2026-08-08T21:13:42.536838Z","submitted_at":"2025-05-26T14:31:48Z","title":"REARANK: Reasoning Re-ranking Agent via Reinforcement Learning","version":1},"reference_index":24,"source":"arxiv_source","source_observed_at":"2026-08-07T14:07:14.028720Z"},"links":{"cited_paper":"/paper/1506.02438","citing_paper":"/paper/2505.20046"},"observation_digest":"sha256:c34bd98a970dedbbc196efb433c1bb06778cb3b867b9a50eff6d4091932919c0","observation_id":"0296164c-0b35-4e30-9a80-89f529fd4188","resolution":{"observed_at":"2026-08-07T14:07:14.028720Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2402.03300","last_updated":"2024-04-27T15:25:53Z","snapshot_observed_at":"2026-08-06T14:58:42.911363Z","submitted_at":"2024-02-05T18:55:32Z","title":"DeepSeekMath: Pushing the Limits of Mathematical Reasoning in Open Language Models","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.03300","snapshot_observed_at":"2026-08-07T14:07:14.134085Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.20046","last_updated":"2025-05-26T14:31:48Z","snapshot_observed_at":"2026-08-08T21:13:42.536838Z","submitted_at":"2025-05-26T14:31:48Z","title":"REARANK: Reasoning Re-ranking Agent via Reinforcement Learning","version":1},"reference_index":25,"source":"arxiv_source","source_observed_at":"2026-08-07T14:07:14.134085Z"},"links":{"cited_paper":"/paper/2402.03300","citing_paper":"/paper/2505.20046"},"observation_digest":"sha256:2c3f0a54e841c16bfdb85392d851287efe57266cd89b77c597ff25cda9e3b744","observation_id":"103375a3-cf07-496d-bc5b-940c4656a681","resolution":{"observed_at":"2026-08-07T14:07:14.134085Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2409.19256","last_updated":"2024-10-02T04:01:47Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-09-28T06:20:03Z","title":"HybridFlow: A Flexible and Efficient RLHF Framework","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2409.19256","snapshot_observed_at":"2026-08-07T14:07:14.250669Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.20046","last_updated":"2025-05-26T14:31:48Z","snapshot_observed_at":"2026-08-08T21:13:42.536838Z","submitted_at":"2025-05-26T14:31:48Z","title":"REARANK: Reasoning Re-ranking Agent via Reinforcement Learning","version":1},"reference_index":26,"source":"arxiv_source","source_observed_at":"2026-08-07T14:07:14.250669Z"},"links":{"cited_paper":"/paper/2409.19256","citing_paper":"/paper/2505.20046"},"observation_digest":"sha256:4a2c260ebba70d2816a00e8e73cbb350738e0225c4973eee23ae5ca91435d8a0","observation_id":"e59a1758-8aed-4e56-92bc-2bbd02c4d1f6","resolution":{"observed_at":"2026-08-07T14:07:14.250669Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2407.12883","last_updated":"2025-03-26T07:37:26Z","snapshot_observed_at":"2026-07-06T18:48:04.031944Z","submitted_at":"2024-07-16T17:58:27Z","title":"BRIGHT: A Realistic and Challenging Benchmark for Reasoning-Intensive Retrieval","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2407.12883","snapshot_observed_at":"2026-08-07T14:07:14.344080Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.20046","last_updated":"2025-05-26T14:31:48Z","snapshot_observed_at":"2026-08-08T21:13:42.536838Z","submitted_at":"2025-05-26T14:31:48Z","title":"REARANK: Reasoning Re-ranking Agent via Reinforcement Learning","version":1},"reference_index":27,"source":"arxiv_source","source_observed_at":"2026-08-07T14:07:14.344080Z"},"links":{"cited_paper":"/paper/2407.12883","citing_paper":"/paper/2505.20046"},"observation_digest":"sha256:0577306b18cb891ef12e9de9004dfe044496491e23423eacbaeb9c188116e2f9","observation_id":"3608c238-937c-4e7d-85e2-0c785f42a213","resolution":{"observed_at":"2026-08-07T14:07:14.344080Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2304.09542","last_updated":"2024-12-28T06:20:54Z","snapshot_observed_at":"2026-08-06T00:21:17.259026Z","submitted_at":"2023-04-19T10:16:03Z","title":"Is ChatGPT Good at Search? Investigating Large Language Models as Re-Ranking Agents","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2304.09542","snapshot_observed_at":"2026-08-07T14:07:14.431147Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.20046","last_updated":"2025-05-26T14:31:48Z","snapshot_observed_at":"2026-08-08T21:13:42.536838Z","submitted_at":"2025-05-26T14:31:48Z","title":"REARANK: Reasoning Re-ranking Agent via Reinforcement Learning","version":1},"reference_index":28,"source":"arxiv_source","source_observed_at":"2026-08-07T14:07:14.431147Z"},"links":{"cited_paper":"/paper/2304.09542","citing_paper":"/paper/2505.20046"},"observation_digest":"sha256:e79466a8cceb4044cb8f767405a69405c4b264fcf058b69f892488c8d7fb2544","observation_id":"a60c737a-9a62-4961-a1bb-ca5ad58ffc21","resolution":{"observed_at":"2026-08-07T14:07:14.431147Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2104.08663","last_updated":"2021-10-21T01:18:28Z","snapshot_observed_at":"2026-08-09T23:22:21.200279Z","submitted_at":"2021-04-17T23:29:55Z","title":"BEIR: A Heterogenous Benchmark for Zero-shot Evaluation of Information Retrieval Models","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2104.08663","snapshot_observed_at":"2026-08-07T14:07:14.526870Z","title":null,"venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2505.20046","last_updated":"2025-05-26T14:31:48Z","snapshot_observed_at":"2026-08-08T21:13:42.536838Z","submitted_at":"2025-05-26T14:31:48Z","title":"REARANK: Reasoning Re-ranking Agent via Reinforcement Learning","version":1},"reference_index":29,"source":"arxiv_source","source_observed_at":"2026-08-07T14:07:14.526870Z"},"links":{"cited_paper":"/paper/2104.08663","citing_paper":"/paper/2505.20046"},"observation_digest":"sha256:aecea092fa456314f2732163de5c39e674b05c0a1c019e28926e12a7e691e730","observation_id":"becac842-21d4-47cc-a338-ae3d3902620a","resolution":{"observed_at":"2026-08-07T14:07:14.526870Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:07:17.048939Z","title":null,"venue":null,"work_id":"85d8762d-b9f5-4255-b3b5-d8ef8e762c7a","year":2021},"citing_paper":{"arxiv_id":"2505.20046","last_updated":"2025-05-26T14:31:48Z","snapshot_observed_at":"2026-08-08T21:13:42.536838Z","submitted_at":"2025-05-26T14:31:48Z","title":"REARANK: Reasoning Re-ranking Agent via Reinforcement Learning","version":1},"reference_index":30,"source":"arxiv_source","source_observed_at":"2026-08-07T14:07:14.614063Z"},"links":{"citing_paper":"/paper/2505.20046"},"observation_digest":"sha256:d6b9a88c02251e29d459d019fe87656c02527dcd4ca15e03e3c314ccfbf4fb61","observation_id":"fda85731-37e3-4a93-acdc-381f04a3d1db","resolution":{"observed_at":"2026-08-07T14:07:17.100374Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2203.11171","last_updated":"2023-03-07T17:57:37Z","snapshot_observed_at":"2026-07-06T12:50:22.773056Z","submitted_at":"2022-03-21T17:48:52Z","title":"Self-Consistency Improves Chain of Thought Reasoning in Language Models","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2203.11171","snapshot_observed_at":"2026-08-07T14:07:14.696818Z","title":null,"venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2505.20046","last_updated":"2025-05-26T14:31:48Z","snapshot_observed_at":"2026-08-08T21:13:42.536838Z","submitted_at":"2025-05-26T14:31:48Z","title":"REARANK: Reasoning Re-ranking Agent via Reinforcement Learning","version":1},"reference_index":31,"source":"arxiv_source","source_observed_at":"2026-08-07T14:07:14.696818Z"},"links":{"cited_paper":"/paper/2203.11171","citing_paper":"/paper/2505.20046"},"observation_digest":"sha256:b50d7e4dafee879b99d0d03bafee248467b376f898253f4cdd474a150d8ff1f5","observation_id":"ea2088e5-e1a7-40ac-a035-46f613437a04","resolution":{"observed_at":"2026-08-07T14:07:14.696818Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2206.07682","last_updated":"2022-10-26T05:06:24Z","snapshot_observed_at":"2026-08-02T15:56:35.249569Z","submitted_at":"2022-06-15T17:32:01Z","title":"Emergent Abilities of Large Language Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2206.07682","snapshot_observed_at":"2026-08-07T14:07:14.782602Z","title":null,"venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2505.20046","last_updated":"2025-05-26T14:31:48Z","snapshot_observed_at":"2026-08-08T21:13:42.536838Z","submitted_at":"2025-05-26T14:31:48Z","title":"REARANK: Reasoning Re-ranking Agent via Reinforcement Learning","version":1},"reference_index":32,"source":"arxiv_source","source_observed_at":"2026-08-07T14:07:14.782602Z"},"links":{"cited_paper":"/paper/2206.07682","citing_paper":"/paper/2505.20046"},"observation_digest":"sha256:09f07eaa77d7a94688f2824c48269f082a6becccb9395ae56e6d4b8a1cecc2a9","observation_id":"f0ac9cea-bce0-49d1-9bde-c1bcddb7f672","resolution":{"observed_at":"2026-08-07T14:07:14.782602Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:07:14.862808Z","title":null,"venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2505.20046","last_updated":"2025-05-26T14:31:48Z","snapshot_observed_at":"2026-08-08T21:13:42.536838Z","submitted_at":"2025-05-26T14:31:48Z","title":"REARANK: Reasoning Re-ranking Agent via Reinforcement Learning","version":1},"reference_index":33,"source":"arxiv_source","source_observed_at":"2026-08-07T14:07:14.862808Z"},"links":{"citing_paper":"/paper/2505.20046"},"observation_digest":"sha256:1b749fcbf055519a2f877c7d159df3377c8ceab6bed3db887bc17f949c01ae42","observation_id":"501bf601-8980-4164-ab27-58d4b8670a56","resolution":{"observed_at":"2026-08-07T14:07:14.862808Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2007.00808","last_updated":"2020-10-20T22:17:19Z","snapshot_observed_at":"2026-08-06T15:45:53.027828Z","submitted_at":"2020-07-01T23:15:56Z","title":"Approximate Nearest Neighbor Negative Contrastive Learning for Dense Text Retrieval","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2007.00808","snapshot_observed_at":"2026-08-07T14:07:14.938648Z","title":null,"venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2505.20046","last_updated":"2025-05-26T14:31:48Z","snapshot_observed_at":"2026-08-08T21:13:42.536838Z","submitted_at":"2025-05-26T14:31:48Z","title":"REARANK: Reasoning Re-ranking Agent via Reinforcement Learning","version":1},"reference_index":34,"source":"arxiv_source","source_observed_at":"2026-08-07T14:07:14.938648Z"},"links":{"cited_paper":"/paper/2007.00808","citing_paper":"/paper/2505.20046"},"observation_digest":"sha256:37fbf423f02ac0238bd1c74bf192724f9c5ac671ecac3aecdf413fd982d013a4","observation_id":"56ca47ee-e6b4-4438-bff4-72819e86f1c6","resolution":{"observed_at":"2026-08-07T14:07:14.938648Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2505.09388","last_updated":"2025-05-14T13:41:34Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-05-14T13:41:34Z","title":"Qwen3 Technical Report","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2505.09388","snapshot_observed_at":"2026-08-07T14:07:15.031918Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2505.20046","last_updated":"2025-05-26T14:31:48Z","snapshot_observed_at":"2026-08-08T21:13:42.536838Z","submitted_at":"2025-05-26T14:31:48Z","title":"REARANK: Reasoning Re-ranking Agent via Reinforcement Learning","version":1},"reference_index":35,"source":"arxiv_source","source_observed_at":"2026-08-07T14:07:15.031918Z"},"links":{"cited_paper":"/paper/2505.09388","citing_paper":"/paper/2505.20046"},"observation_digest":"sha256:bdeab2811249d2e82beb813878ee0a20cf43bcee6938525936e6b24e45751c91","observation_id":"47b725ec-579a-41bf-9a7f-93cddda09935","resolution":{"observed_at":"2026-08-07T14:07:15.031918Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2412.15115","last_updated":"2025-01-03T02:18:21Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-12-19T17:56:09Z","title":"Qwen2.5 Technical Report","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2412.15115","snapshot_observed_at":"2026-08-07T14:07:15.119898Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.20046","last_updated":"2025-05-26T14:31:48Z","snapshot_observed_at":"2026-08-08T21:13:42.536838Z","submitted_at":"2025-05-26T14:31:48Z","title":"REARANK: Reasoning Re-ranking Agent via Reinforcement Learning","version":1},"reference_index":36,"source":"arxiv_source","source_observed_at":"2026-08-07T14:07:15.119898Z"},"links":{"cited_paper":"/paper/2412.15115","citing_paper":"/paper/2505.20046"},"observation_digest":"sha256:9262e5aa11ad8531cc2107a1a3ec11642f9e89ca011d4369514764cc41f5be8e","observation_id":"9b5abaf1-5858-4275-9b24-27f187242f37","resolution":{"observed_at":"2026-08-07T14:07:15.119898Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2502.03387","last_updated":"2025-07-29T16:23:02Z","snapshot_observed_at":"2026-08-08T04:13:22.884923Z","submitted_at":"2025-02-05T17:23:45Z","title":"LIMO: Less is More for Reasoning","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2502.03387","snapshot_observed_at":"2026-08-07T14:07:15.204385Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2505.20046","last_updated":"2025-05-26T14:31:48Z","snapshot_observed_at":"2026-08-08T21:13:42.536838Z","submitted_at":"2025-05-26T14:31:48Z","title":"REARANK: Reasoning Re-ranking Agent via Reinforcement Learning","version":1},"reference_index":37,"source":"arxiv_source","source_observed_at":"2026-08-07T14:07:15.204385Z"},"links":{"cited_paper":"/paper/2502.03387","citing_paper":"/paper/2505.20046"},"observation_digest":"sha256:ed1a601bd5662ba566621a53e116fdded617b2598e72acc4c0e902c93ada8610","observation_id":"aed25547-7cdf-423d-a46d-6f5ddd45e1d0","resolution":{"observed_at":"2026-08-07T14:07:15.204385Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:07:16.875239Z","title":null,"venue":null,"work_id":"6efdb206-6124-453c-bca8-0bcb6a73c533","year":2024},"citing_paper":{"arxiv_id":"2505.20046","last_updated":"2025-05-26T14:31:48Z","snapshot_observed_at":"2026-08-08T21:13:42.536838Z","submitted_at":"2025-05-26T14:31:48Z","title":"REARANK: Reasoning Re-ranking Agent via Reinforcement Learning","version":1},"reference_index":38,"source":"arxiv_source","source_observed_at":"2026-08-07T14:07:15.268427Z"},"links":{"citing_paper":"/paper/2505.20046"},"observation_digest":"sha256:58bcd87d21610528247fe9b7bf5ee23a96672c72a0d8b1d118f540bb024def4d","observation_id":"68e4fece-e2f6-47de-80b8-99a6a2635ef0","resolution":{"observed_at":"2026-08-07T14:07:16.945437Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2310.13265","last_updated":"2023-10-20T04:09:36Z","snapshot_observed_at":"2026-07-06T16:36:00.246846Z","submitted_at":"2023-10-20T04:09:36Z","title":"MoqaGPT : Zero-Shot Multi-modal Open-domain Question Answering with Large Language Model","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2310.13265","snapshot_observed_at":"2026-08-07T14:07:15.313276Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.20046","last_updated":"2025-05-26T14:31:48Z","snapshot_observed_at":"2026-08-08T21:13:42.536838Z","submitted_at":"2025-05-26T14:31:48Z","title":"REARANK: Reasoning Re-ranking Agent via Reinforcement Learning","version":1},"reference_index":39,"source":"arxiv_source","source_observed_at":"2026-08-07T14:07:15.313276Z"},"links":{"cited_paper":"/paper/2310.13265","citing_paper":"/paper/2505.20046"},"observation_digest":"sha256:9be215bcee742b52cbf7ce3832c7afd6772c0f945e52841091cd2e5bcb8d81da","observation_id":"e0e7d205-670b-414d-9dc3-fd0d33be3fa2","resolution":{"observed_at":"2026-08-07T14:07:15.313276Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2401.06311","last_updated":"2024-06-29T15:42:47Z","snapshot_observed_at":"2026-07-06T17:14:36.670116Z","submitted_at":"2024-01-12T00:48:35Z","title":"Exploring the Best Practices of Query Expansion with Large Language Models","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2401.06311","snapshot_observed_at":"2026-08-07T14:07:15.431975Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.20046","last_updated":"2025-05-26T14:31:48Z","snapshot_observed_at":"2026-08-08T21:13:42.536838Z","submitted_at":"2025-05-26T14:31:48Z","title":"REARANK: Reasoning Re-ranking Agent via Reinforcement Learning","version":1},"reference_index":40,"source":"arxiv_source","source_observed_at":"2026-08-07T14:07:15.431975Z"},"links":{"cited_paper":"/paper/2401.06311","citing_paper":"/paper/2505.20046"},"observation_digest":"sha256:e079d7cdbcdbb1504f9939cd0e0021554a15d9b68b92b5a80873bfcd1eede4d2","observation_id":"0d263f1a-8584-4870-8589-6f015d4fab51","resolution":{"observed_at":"2026-08-07T14:07:15.431975Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2412.04616","last_updated":"2025-04-19T15:39:32Z","snapshot_observed_at":"2026-07-06T20:02:30.984571Z","submitted_at":"2024-12-05T21:04:58Z","title":"Assessing and Learning Alignment of Unimodal Vision and Language Models","version":2},"cited_work":{"arxiv_id":"2412.04616","doi":null,"metadata_source":"pith","pith_arxiv_id":"2412.04616","snapshot_observed_at":"2026-08-07T14:07:16.032620Z","title":"Assessing and Learning Alignment of Unimodal Vision and Language Models","venue":"cs.CV","work_id":"e272fd19-9cf4-424f-abff-e31a9801dd92","year":2024},"citing_paper":{"arxiv_id":"2505.20046","last_updated":"2025-05-26T14:31:48Z","snapshot_observed_at":"2026-08-08T21:13:42.536838Z","submitted_at":"2025-05-26T14:31:48Z","title":"REARANK: Reasoning Re-ranking Agent via Reinforcement Learning","version":1},"reference_index":41,"source":"arxiv_source","source_observed_at":"2026-08-07T14:07:15.516659Z"},"links":{"cited_paper":"/paper/2412.04616","citing_paper":"/paper/2505.20046"},"observation_digest":"sha256:03cce9c837fe19923245a14228e7ce236782ef77beaf97667a9a288469c70e2e","observation_id":"b3bd474b-6d74-4e3b-b6d4-ce42b5804e26","resolution":{"observed_at":"2026-08-07T14:07:16.104172Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2503.06034","last_updated":"2025-03-08T03:14:26Z","snapshot_observed_at":"2026-08-07T17:20:46.152437Z","submitted_at":"2025-03-08T03:14:26Z","title":"Rank-R1: Enhancing Reasoning in LLM-based Document Rerankers via Reinforcement Learning","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2503.06034","snapshot_observed_at":"2026-08-07T14:07:15.608784Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2505.20046","last_updated":"2025-05-26T14:31:48Z","snapshot_observed_at":"2026-08-08T21:13:42.536838Z","submitted_at":"2025-05-26T14:31:48Z","title":"REARANK: Reasoning Re-ranking Agent via Reinforcement Learning","version":1},"reference_index":42,"source":"arxiv_source","source_observed_at":"2026-08-07T14:07:15.608784Z"},"links":{"cited_paper":"/paper/2503.06034","citing_paper":"/paper/2505.20046"},"observation_digest":"sha256:82e9caeb11cb9a74a78b734f805c449b8437b89affda74971ba074a10f784ccc","observation_id":"9a046267-0fb6-4f94-9061-a14fe4bd8d06","resolution":{"observed_at":"2026-08-07T14:07:15.608784Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:07:15.689635Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.20046","last_updated":"2025-05-26T14:31:48Z","snapshot_observed_at":"2026-08-08T21:13:42.536838Z","submitted_at":"2025-05-26T14:31:48Z","title":"REARANK: Reasoning Re-ranking Agent via Reinforcement Learning","version":1},"reference_index":43,"source":"arxiv_source","source_observed_at":"2026-08-07T14:07:15.689635Z"},"links":{"citing_paper":"/paper/2505.20046"},"observation_digest":"sha256:287c6dba77ab59f7675652a1d85921a1818ba0d7fcfec9e6143e1b7f96966534","observation_id":"e8854213-5ce7-4bcc-9724-c58a87ecd53d","resolution":{"observed_at":"2026-08-07T14:07:15.689635Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:07:15.782529Z","title":"online\" 'onlinestring :=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2505.20046","last_updated":"2025-05-26T14:31:48Z","snapshot_observed_at":"2026-08-08T21:13:42.536838Z","submitted_at":"2025-05-26T14:31:48Z","title":"REARANK: Reasoning Re-ranking Agent via Reinforcement Learning","version":1},"reference_index":44,"source":"arxiv_source","source_observed_at":"2026-08-07T14:07:15.782529Z"},"links":{"citing_paper":"/paper/2505.20046"},"observation_digest":"sha256:d11e680398131c7f8af5a1ff41af8d0ef876cf23696dafede40edb1c3b7604fc","observation_id":"099797bc-7ed4-4034-9836-dfdaf626f65b","resolution":{"observed_at":"2026-08-07T14:07:15.782529Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:07:15.898573Z","title":"write newline","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2505.20046","last_updated":"2025-05-26T14:31:48Z","snapshot_observed_at":"2026-08-08T21:13:42.536838Z","submitted_at":"2025-05-26T14:31:48Z","title":"REARANK: Reasoning Re-ranking Agent via Reinforcement Learning","version":1},"reference_index":45,"source":"arxiv_source","source_observed_at":"2026-08-07T14:07:15.898573Z"},"links":{"citing_paper":"/paper/2505.20046"},"observation_digest":"sha256:2d45905941aefe443f7723cc2c83ae684fa26a33440b13e1494f3edb1f046f0d","observation_id":"e2ae1378-e3c4-43df-9280-daffdc4c725b","resolution":{"observed_at":"2026-08-07T14:07:15.898573Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"paper":{"arxiv_id":"2505.20046","last_updated":"2025-05-26T14:31:48Z","latest_version":1,"primary_category":"cs.IR","snapshot_observed_at":"2026-08-08T21:13:42.536838Z","submitted_at":"2025-05-26T14:31:48Z","title":"REARANK: Reasoning Re-ranking Agent via Reinforcement Learning"},"reference_resolution":{"displayed":44,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":43,"verified_exact":1,"verified_fuzzy":0},"total_outbound_references":44},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"thesis":"As of 10 August 2026, this Paper Citation Record lists 44 of 44 outbound references and 7 inbound Pith citation observations for arXiv:2505.20046."}