{"as_of":"2026-08-15T19:00:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:9126f0ab3d8b0bc2f5abf29c7aedb911619fab55dd292f820286e90b4b40b8ad","coverage":[{"denominator":54,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":54,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-07T14:53:20.422106Z","state":"measured"},{"denominator":57,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":57,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-15T06:32:42.880941+00:00","state":"measured"},{"denominator":3,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":3,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-07T05:38:36.016920Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"arxiv_reference","source_observed_at":"2026-06-30T12:24:39.589042Z","state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2505.17391","last_updated":"2025-05-23T02:01:15Z","snapshot_observed_at":"2026-08-08T00:22:36.393355Z","submitted_at":"2025-05-23T02:01:15Z","title":"Curriculum Guided Reinforcement Learning for Efficient Multi Hop Retrieval Augmented Generation","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2505.17391","snapshot_observed_at":"2026-08-07T05:38:36.016920Z","title":"Curriculum guided reinforcement learning for efficient multi hop retrieval augmented generation,","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2506.07411","last_updated":"2025-06-09T04:14:05Z","snapshot_observed_at":"2026-08-15T06:17:51.743739Z","submitted_at":"2025-06-09T04:14:05Z","title":"An Intelligent Fault Self-Healing Mechanism for Cloud AI Systems via Integration of Large Language Models and Deep Reinforcement Learning","version":1},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-08-07T05:38:36.016920Z"},"links":{"cited_paper":"/paper/2505.17391","citing_paper":"/paper/2506.07411"},"observation_digest":"sha256:bfba52f8bdcbc1d0ec1c0819b281e424185f21ff13a6d753f8f9714866765e31","observation_id":"a8e4edd0-7322-4a71-aaed-5d0579545e48","resolution":{"observed_at":"2026-08-07T05:38:36.016920Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2505.17391","last_updated":"2025-05-23T02:01:15Z","snapshot_observed_at":"2026-08-08T00:22:36.393355Z","submitted_at":"2025-05-23T02:01:15Z","title":"Curriculum Guided Reinforcement Learning for Efficient Multi Hop Retrieval Augmented Generation","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2505.17391","snapshot_observed_at":"2026-07-15T14:43:21.866055Z","title":"Curriculum guided reinforcement learning for efficient multi hop retrieval augmented generation.ArXiv, abs/2505.17391,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2603.05256","last_updated":"2026-07-02T16:41:10Z","snapshot_observed_at":"2026-08-15T11:05:28.641637Z","submitted_at":"2026-03-05T15:08:06Z","title":"Wiki-R1: Incentivizing Multimodal Reasoning for Knowledge-based VQA via Data and Sampling Curriculum","version":2},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-07-15T14:43:21.866055Z"},"links":{"cited_paper":"/paper/2505.17391","citing_paper":"/paper/2603.05256"},"observation_digest":"sha256:601044de60695c69e5aacb2f0d31ee12761a28dad2ab2c830d78a88a53bbf4f9","observation_id":"4a4d6b1b-9181-4a1b-968b-c05b004996ec","resolution":{"observed_at":"2026-07-15T14:43:21.866055Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2505.17391","last_updated":"2025-05-23T02:01:15Z","snapshot_observed_at":"2026-08-08T00:22:36.393355Z","submitted_at":"2025-05-23T02:01:15Z","title":"Curriculum Guided Reinforcement Learning for Efficient Multi Hop Retrieval Augmented Generation","version":1},"cited_work":{"arxiv_id":"2505.17391","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2505.17391","snapshot_observed_at":"2026-06-30T12:24:39.589042Z","title":"Curriculum Guided Reinforce- ment Learning for Efficient Multi-Hop Retrieval-Augmented Generation.arXiv preprint arXiv:2505.17391, 2025","venue":null,"work_id":"dcb04725-7d3b-414a-a3bd-e6b4c647744e","year":2025},"citing_paper":{"arxiv_id":"2605.24660","last_updated":"2026-06-07T02:58:55Z","snapshot_observed_at":"2026-08-12T22:54:59.017055Z","submitted_at":"2026-05-23T17:02:56Z","title":"How Many Tools Should an LLM Agent See? A Chance-Corrected Answer","version":2},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-06-30T12:22:59.494989Z"},"links":{"cited_paper":"/paper/2505.17391","citing_paper":"/paper/2605.24660"},"observation_digest":"sha256:c892eb4e72ff5be815bca866dc318a54c4e4f9c759348977ac8f0083afb08964","observation_id":"e81a4a00-2486-416b-8351-ec8c56bdf6fc","resolution":{"observed_at":"2026-06-30T12:24:39.591834Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}}],"links":{"evidence":"/evidence","html":"/paper/2505.17391/citation-record","integrity":"/paper/2505.17391/integrity","json":"/paper/2505.17391/citation-record.json","paper":"/paper/2505.17391"},"outbound":[{"citation":{"cited_paper":{"arxiv_id":"2303.08774","last_updated":"2024-03-04T06:01:33Z","snapshot_observed_at":"2026-08-07T07:30:12.213965Z","submitted_at":"2023-03-15T17:15:04Z","title":"GPT-4 Technical Report","version":6},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2303.08774","snapshot_observed_at":"2026-08-07T14:53:15.014802Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.17391","last_updated":"2025-05-23T02:01:15Z","snapshot_observed_at":"2026-08-08T00:22:36.393355Z","submitted_at":"2025-05-23T02:01:15Z","title":"Curriculum Guided Reinforcement Learning for Efficient Multi Hop Retrieval Augmented Generation","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-07T14:53:15.014802Z"},"links":{"cited_paper":"/paper/2303.08774","citing_paper":"/paper/2505.17391"},"observation_digest":"sha256:6d2b06bcf406f99495c664f063be5e873c0dee7b6cffd02f826df4ff308d87bb","observation_id":"84580aae-49ab-4e5b-a947-a36f7b326f54","resolution":{"observed_at":"2026-08-07T14:53:15.014802Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:53:15.090620Z","title":null,"venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2505.17391","last_updated":"2025-05-23T02:01:15Z","snapshot_observed_at":"2026-08-08T00:22:36.393355Z","submitted_at":"2025-05-23T02:01:15Z","title":"Curriculum Guided Reinforcement Learning for Efficient Multi Hop Retrieval Augmented Generation","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-07T14:53:15.090620Z"},"links":{"citing_paper":"/paper/2505.17391"},"observation_digest":"sha256:595fa0c484e8cd0da923c21781556d02574cc7cfa61efacc80153c08baede9ce","observation_id":"b1223b34-7823-41f3-9505-7cec79c8b9c5","resolution":{"observed_at":"2026-08-07T14:53:15.090620Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:53:15.172121Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.17391","last_updated":"2025-05-23T02:01:15Z","snapshot_observed_at":"2026-08-08T00:22:36.393355Z","submitted_at":"2025-05-23T02:01:15Z","title":"Curriculum Guided Reinforcement Learning for Efficient Multi Hop Retrieval Augmented Generation","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-07T14:53:15.172121Z"},"links":{"citing_paper":"/paper/2505.17391"},"observation_digest":"sha256:a528e3a1188bca32ed81b414767a7404ba8f6463c4202c2b924a6d8f929e2019","observation_id":"e647cb5a-7a64-4daf-bc19-238d22fe4de5","resolution":{"observed_at":"2026-08-07T14:53:15.172121Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2402.03216","last_updated":"2025-12-12T11:26:32Z","snapshot_observed_at":"2026-07-06T17:25:35.493362Z","submitted_at":"2024-02-05T17:26:49Z","title":"M3-Embedding: Multi-Linguality, Multi-Functionality, Multi-Granularity Text Embeddings Through Self-Knowledge Distillation","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.03216","snapshot_observed_at":"2026-08-07T14:53:15.253176Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.17391","last_updated":"2025-05-23T02:01:15Z","snapshot_observed_at":"2026-08-08T00:22:36.393355Z","submitted_at":"2025-05-23T02:01:15Z","title":"Curriculum Guided Reinforcement Learning for Efficient Multi Hop Retrieval Augmented Generation","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-07T14:53:15.253176Z"},"links":{"cited_paper":"/paper/2402.03216","citing_paper":"/paper/2505.17391"},"observation_digest":"sha256:8c21dd2c5aaf27ac1775413db1a2d1a0f9fb38268e3485b9d01d4ab6bd729738","observation_id":"26b516a2-3f6b-4222-9979-2b8b18aa55dc","resolution":{"observed_at":"2026-08-07T14:53:15.253176Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:53:15.393305Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2505.17391","last_updated":"2025-05-23T02:01:15Z","snapshot_observed_at":"2026-08-08T00:22:36.393355Z","submitted_at":"2025-05-23T02:01:15Z","title":"Curriculum Guided Reinforcement Learning for Efficient Multi Hop Retrieval Augmented Generation","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-07T14:53:15.393305Z"},"links":{"citing_paper":"/paper/2505.17391"},"observation_digest":"sha256:50524de7fc8a4eb389c3589c2c0ce68f11a59ada8a2ee64d68fc1146f2081774","observation_id":"2f53c2f6-65b9-409d-9c69-2929e91a1d3a","resolution":{"observed_at":"2026-08-07T14:53:15.393305Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:53:24.290706Z","title":null,"venue":null,"work_id":"f79dfe7f-da64-42db-bdcd-85e196f83217","year":2024},"citing_paper":{"arxiv_id":"2505.17391","last_updated":"2025-05-23T02:01:15Z","snapshot_observed_at":"2026-08-08T00:22:36.393355Z","submitted_at":"2025-05-23T02:01:15Z","title":"Curriculum Guided Reinforcement Learning for Efficient Multi Hop Retrieval Augmented Generation","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-07T14:53:15.543549Z"},"links":{"citing_paper":"/paper/2505.17391"},"observation_digest":"sha256:03e2149130d6811acbdd77a6e931a6eeeeafbc45d55895dafadb95d87b747d0f","observation_id":"8a01c430-ff6b-45bf-acb2-c3183f774fa7","resolution":{"observed_at":"2026-08-07T14:53:24.413542Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:53:24.027246Z","title":null,"venue":null,"work_id":"5d5a0ff5-8f26-455e-9f03-322247c0356c","year":2024},"citing_paper":{"arxiv_id":"2505.17391","last_updated":"2025-05-23T02:01:15Z","snapshot_observed_at":"2026-08-08T00:22:36.393355Z","submitted_at":"2025-05-23T02:01:15Z","title":"Curriculum Guided Reinforcement Learning for Efficient Multi Hop Retrieval Augmented Generation","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-07T14:53:15.635196Z"},"links":{"citing_paper":"/paper/2505.17391"},"observation_digest":"sha256:f876e5735c0500abffaa784cfcfedad52de89ce3ad9db05e3c7449d12f6579a5","observation_id":"039e2d18-1788-4aa4-9d59-4e44b603995d","resolution":{"observed_at":"2026-08-07T14:53:24.166387Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2410.18141","last_updated":"2025-03-10T09:49:31Z","snapshot_observed_at":"2026-08-14T00:53:01.484855Z","submitted_at":"2024-10-22T11:23:11Z","title":"SmartRAG: Jointly Learn RAG-Related Tasks From the Environment Feedback","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2410.18141","snapshot_observed_at":"2026-08-07T14:53:15.758797Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.17391","last_updated":"2025-05-23T02:01:15Z","snapshot_observed_at":"2026-08-08T00:22:36.393355Z","submitted_at":"2025-05-23T02:01:15Z","title":"Curriculum Guided Reinforcement Learning for Efficient Multi Hop Retrieval Augmented Generation","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-07T14:53:15.758797Z"},"links":{"cited_paper":"/paper/2410.18141","citing_paper":"/paper/2505.17391"},"observation_digest":"sha256:ce59b3a32993ae2662b4431136c77d9843206156bcdc7e0709c5f1c24d43c6e5","observation_id":"abad9de6-3882-4b49-b5f0-0a9d21c71ad9","resolution":{"observed_at":"2026-08-07T14:53:15.758797Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2501.12948","last_updated":"2026-01-04T03:57:36Z","snapshot_observed_at":"2026-08-15T12:33:55.451951Z","submitted_at":"2025-01-22T15:19:35Z","title":"DeepSeek-R1: Incentivizing Reasoning Capability in LLMs via Reinforcement Learning","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2501.12948","snapshot_observed_at":"2026-08-07T14:53:15.856749Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2505.17391","last_updated":"2025-05-23T02:01:15Z","snapshot_observed_at":"2026-08-08T00:22:36.393355Z","submitted_at":"2025-05-23T02:01:15Z","title":"Curriculum Guided Reinforcement Learning for Efficient Multi Hop Retrieval Augmented Generation","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-07T14:53:15.856749Z"},"links":{"cited_paper":"/paper/2501.12948","citing_paper":"/paper/2505.17391"},"observation_digest":"sha256:e5de8a0a5260b426a6109f7d320b395d3210c4699a05ee4a74250ffd60529a1e","observation_id":"295591a9-e185-4fcb-a654-41ee1d56cabb","resolution":{"observed_at":"2026-08-07T14:53:15.856749Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:53:23.730283Z","title":null,"venue":null,"work_id":"8e8b38e3-ebd8-47f2-af8c-b9120d08f17d","year":2020},"citing_paper":{"arxiv_id":"2505.17391","last_updated":"2025-05-23T02:01:15Z","snapshot_observed_at":"2026-08-08T00:22:36.393355Z","submitted_at":"2025-05-23T02:01:15Z","title":"Curriculum Guided Reinforcement Learning for Efficient Multi Hop Retrieval Augmented Generation","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-07T14:53:16.025551Z"},"links":{"citing_paper":"/paper/2505.17391"},"observation_digest":"sha256:80b8f728215fd348945d6489b296b987b95013c773e8bdb619ce6cc959737d8a","observation_id":"377f636e-31ba-4bea-b552-724eefd9fc63","resolution":{"observed_at":"2026-08-07T14:53:23.880441Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2503.12759","last_updated":"2025-05-23T21:59:14Z","snapshot_observed_at":"2026-08-15T07:58:01.172171Z","submitted_at":"2025-03-17T02:53:42Z","title":"RAG-RL: Advancing Retrieval-Augmented Generation via RL and Curriculum Learning","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2503.12759","snapshot_observed_at":"2026-08-07T14:53:16.182107Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2505.17391","last_updated":"2025-05-23T02:01:15Z","snapshot_observed_at":"2026-08-08T00:22:36.393355Z","submitted_at":"2025-05-23T02:01:15Z","title":"Curriculum Guided Reinforcement Learning for Efficient Multi Hop Retrieval Augmented Generation","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-07T14:53:16.182107Z"},"links":{"cited_paper":"/paper/2503.12759","citing_paper":"/paper/2505.17391"},"observation_digest":"sha256:5bdba726dfbcd448a42e2dabb5c57c4b0b0103c1613823cbb3f370ac5b6db026","observation_id":"8ac2fce8-de6e-45e0-aa61-f358510b6fb4","resolution":{"observed_at":"2026-08-07T14:53:16.182107Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2504.15296","last_updated":"2025-04-16T04:00:04Z","snapshot_observed_at":"2026-08-14T19:43:54.215262Z","submitted_at":"2025-04-16T04:00:04Z","title":"Scalability Optimization in Cloud-Based AI Inference Services: Strategies for Real-Time Load Balancing and Automated Scaling","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2504.15296","snapshot_observed_at":"2026-08-07T14:53:16.290988Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2505.17391","last_updated":"2025-05-23T02:01:15Z","snapshot_observed_at":"2026-08-08T00:22:36.393355Z","submitted_at":"2025-05-23T02:01:15Z","title":"Curriculum Guided Reinforcement Learning for Efficient Multi Hop Retrieval Augmented Generation","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-07T14:53:16.290988Z"},"links":{"cited_paper":"/paper/2504.15296","citing_paper":"/paper/2505.17391"},"observation_digest":"sha256:3e7afa42005f53cabf253cdd0baa49395ce3e21a20b8182f5dfacc2052ffd506","observation_id":"0479f63e-9310-4086-b9f7-8a97add8c1ac","resolution":{"observed_at":"2026-08-07T14:53:16.290988Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2412.12370","last_updated":"2025-03-19T05:38:58Z","snapshot_observed_at":"2026-08-14T09:26:28.503620Z","submitted_at":"2024-12-16T21:56:01Z","title":"Scam Detection for Ethereum Smart Contracts: Leveraging Graph Representation Learning for Secure Blockchain","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2412.12370","snapshot_observed_at":"2026-08-07T14:53:16.343041Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.17391","last_updated":"2025-05-23T02:01:15Z","snapshot_observed_at":"2026-08-08T00:22:36.393355Z","submitted_at":"2025-05-23T02:01:15Z","title":"Curriculum Guided Reinforcement Learning for Efficient Multi Hop Retrieval Augmented Generation","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-07T14:53:16.343041Z"},"links":{"cited_paper":"/paper/2412.12370","citing_paper":"/paper/2505.17391"},"observation_digest":"sha256:d58dee3f8f3ff39dbee46fde9dae76d5379599a7704cfa31326ef00805aa4342","observation_id":"7a1fd43a-aebc-4bc6-a8a1-eca587d94a2c","resolution":{"observed_at":"2026-08-07T14:53:16.343041Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2503.22303","last_updated":"2025-04-15T08:10:39Z","snapshot_observed_at":"2026-08-07T16:30:36.751044Z","submitted_at":"2025-03-28T10:26:49Z","title":"Preference-based Learning with Retrieval Augmented Generation for Conversational Question Answering","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2503.22303","snapshot_observed_at":"2026-08-07T14:53:16.422285Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2505.17391","last_updated":"2025-05-23T02:01:15Z","snapshot_observed_at":"2026-08-08T00:22:36.393355Z","submitted_at":"2025-05-23T02:01:15Z","title":"Curriculum Guided Reinforcement Learning for Efficient Multi Hop Retrieval Augmented Generation","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-07T14:53:16.422285Z"},"links":{"cited_paper":"/paper/2503.22303","citing_paper":"/paper/2505.17391"},"observation_digest":"sha256:05cfedc8d92710f1a7d744bafd35f8d6efefc15dc5f528cdb56946824e244256","observation_id":"6846f235-c473-4af6-a352-1509aebe99e4","resolution":{"observed_at":"2026-08-07T14:53:16.422285Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:53:16.490441Z","title":null,"venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2505.17391","last_updated":"2025-05-23T02:01:15Z","snapshot_observed_at":"2026-08-08T00:22:36.393355Z","submitted_at":"2025-05-23T02:01:15Z","title":"Curriculum Guided Reinforcement Learning for Efficient Multi Hop Retrieval Augmented Generation","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-07T14:53:16.490441Z"},"links":{"citing_paper":"/paper/2505.17391"},"observation_digest":"sha256:e64ca38201b5b4d0d56aebf84865788fad7f9d6af570fa69f6ab65b41b3faac7","observation_id":"bb714cf5-580a-441b-a1c5-61ec151efa15","resolution":{"observed_at":"2026-08-07T14:53:16.490441Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:53:23.527484Z","title":null,"venue":null,"work_id":"ad4c3706-7e01-4021-a26f-513df053c174","year":null},"citing_paper":{"arxiv_id":"2505.17391","last_updated":"2025-05-23T02:01:15Z","snapshot_observed_at":"2026-08-08T00:22:36.393355Z","submitted_at":"2025-05-23T02:01:15Z","title":"Curriculum Guided Reinforcement Learning for Efficient Multi Hop Retrieval Augmented Generation","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-07T14:53:16.568447Z"},"links":{"citing_paper":"/paper/2505.17391"},"observation_digest":"sha256:531a21c320e66f507abb82c0e482b3228f161e8dce6c77c316d00056227b1727","observation_id":"135b4c42-2b87-4f75-bd93-790c51a6da14","resolution":{"observed_at":"2026-08-07T14:53:23.593145Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:53:16.815679Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.17391","last_updated":"2025-05-23T02:01:15Z","snapshot_observed_at":"2026-08-08T00:22:36.393355Z","submitted_at":"2025-05-23T02:01:15Z","title":"Curriculum Guided Reinforcement Learning for Efficient Multi Hop Retrieval Augmented Generation","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-07T14:53:16.815679Z"},"links":{"citing_paper":"/paper/2505.17391"},"observation_digest":"sha256:84668f579c39367394641a2e675ad221778834b26599de2dfab14da10e0de539","observation_id":"d6ec0ae4-69fc-4f73-82b3-45a5ce4624c4","resolution":{"observed_at":"2026-08-07T14:53:16.815679Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2406.17918","last_updated":"2025-01-11T15:26:48Z","snapshot_observed_at":"2026-08-14T09:20:19.704410Z","submitted_at":"2024-06-25T20:00:32Z","title":"GraphSnapShot: Caching Local Structure for Fast Graph Learning","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2406.17918","snapshot_observed_at":"2026-08-07T14:53:16.891893Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.17391","last_updated":"2025-05-23T02:01:15Z","snapshot_observed_at":"2026-08-08T00:22:36.393355Z","submitted_at":"2025-05-23T02:01:15Z","title":"Curriculum Guided Reinforcement Learning for Efficient Multi Hop Retrieval Augmented Generation","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-07T14:53:16.891893Z"},"links":{"cited_paper":"/paper/2406.17918","citing_paper":"/paper/2505.17391"},"observation_digest":"sha256:e9a02ed3a304f793b6f52fe48a62737ba8feb3582d49db49a66ce3b3b217fcb1","observation_id":"1a909371-337d-479f-bc02-2dcc140df3d2","resolution":{"observed_at":"2026-08-07T14:53:16.891893Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2406.18038","last_updated":"2025-05-01T03:27:16Z","snapshot_observed_at":"2026-08-13T21:16:08.346316Z","submitted_at":"2024-06-26T03:12:07Z","title":"MT2ST: Adaptive Multi-Task to Single-Task Learning","version":6},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2406.18038","snapshot_observed_at":"2026-08-07T14:53:17.031547Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.17391","last_updated":"2025-05-23T02:01:15Z","snapshot_observed_at":"2026-08-08T00:22:36.393355Z","submitted_at":"2025-05-23T02:01:15Z","title":"Curriculum Guided Reinforcement Learning for Efficient Multi Hop Retrieval Augmented Generation","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-07T14:53:17.031547Z"},"links":{"cited_paper":"/paper/2406.18038","citing_paper":"/paper/2505.17391"},"observation_digest":"sha256:ecda81a592aa9ab0ba12ac6d22ef06285a13cdf1bc5191e7f88f027ad65aa941","observation_id":"55e628ee-cdee-4d60-ad0f-da3aec743336","resolution":{"observed_at":"2026-08-07T14:53:17.031547Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2502.10993","last_updated":"2025-02-16T04:56:53Z","snapshot_observed_at":"2026-08-13T20:58:55.526405Z","submitted_at":"2025-02-16T04:56:53Z","title":"RoseRAG: Robust Retrieval-augmented Generation with Small-scale LLMs via Margin-aware Preference Optimization","version":1},"cited_work":{"arxiv_id":"2502.10993","doi":null,"metadata_source":"pith","pith_arxiv_id":"2502.10993","snapshot_observed_at":"2026-08-07T14:53:21.088040Z","title":"RoseRAG: Robust Retrieval-augmented Generation with Small-scale LLMs via Margin-aware Preference Optimization","venue":"cs.CL","work_id":"425d03e5-ca2f-4380-9888-d20a06728e60","year":2025},"citing_paper":{"arxiv_id":"2505.17391","last_updated":"2025-05-23T02:01:15Z","snapshot_observed_at":"2026-08-08T00:22:36.393355Z","submitted_at":"2025-05-23T02:01:15Z","title":"Curriculum Guided Reinforcement Learning for Efficient Multi Hop Retrieval Augmented Generation","version":1},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-07T14:53:17.147456Z"},"links":{"cited_paper":"/paper/2502.10993","citing_paper":"/paper/2505.17391"},"observation_digest":"sha256:f530c6f5a82051c05c78acf88cc21ad2c5c89de2e38edd3ffd8b1001bb36f032","observation_id":"a4229d85-f16d-4e20-8480-db5eb1cdc559","resolution":{"observed_at":"2026-08-07T14:53:21.147377Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:53:17.220200Z","title":null,"venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2505.17391","last_updated":"2025-05-23T02:01:15Z","snapshot_observed_at":"2026-08-08T00:22:36.393355Z","submitted_at":"2025-05-23T02:01:15Z","title":"Curriculum Guided Reinforcement Learning for Efficient Multi Hop Retrieval Augmented Generation","version":1},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-07T14:53:17.220200Z"},"links":{"citing_paper":"/paper/2505.17391"},"observation_digest":"sha256:9d2510bfbe38c5fbe5ebc178b93c48b17279139ad46bb5624266ce027dc06637","observation_id":"533c38c7-6d3b-46c3-9564-95402c1fc9c3","resolution":{"observed_at":"2026-08-07T14:53:17.220200Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2210.03350","last_updated":"2023-10-17T18:57:17Z","snapshot_observed_at":"2026-08-15T17:25:43.175408Z","submitted_at":"2022-10-07T06:50:23Z","title":"Measuring and Narrowing the Compositionality Gap in Language Models","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2210.03350","snapshot_observed_at":"2026-08-07T14:53:17.278436Z","title":null,"venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2505.17391","last_updated":"2025-05-23T02:01:15Z","snapshot_observed_at":"2026-08-08T00:22:36.393355Z","submitted_at":"2025-05-23T02:01:15Z","title":"Curriculum Guided Reinforcement Learning for Efficient Multi Hop Retrieval Augmented Generation","version":1},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-07T14:53:17.278436Z"},"links":{"cited_paper":"/paper/2210.03350","citing_paper":"/paper/2505.17391"},"observation_digest":"sha256:a599196ab199e087aebb8e487010927aaffc463fbbba3af2b8691672d2ce8ef0","observation_id":"2d613936-fc9a-410d-8334-e06e29eb841e","resolution":{"observed_at":"2026-08-07T14:53:17.278436Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:53:17.384276Z","title":null,"venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2505.17391","last_updated":"2025-05-23T02:01:15Z","snapshot_observed_at":"2026-08-08T00:22:36.393355Z","submitted_at":"2025-05-23T02:01:15Z","title":"Curriculum Guided Reinforcement Learning for Efficient Multi Hop Retrieval Augmented Generation","version":1},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-07T14:53:17.384276Z"},"links":{"citing_paper":"/paper/2505.17391"},"observation_digest":"sha256:bc91d6c8ffd26dde7a6c1f1b25d63b8a2d178e7fb8f97d42c39ee6017f101245","observation_id":"67a2c890-f157-47bd-ac7e-cc5c12c380fe","resolution":{"observed_at":"2026-08-07T14:53:17.384276Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:53:17.488743Z","title":null,"venue":null,"work_id":null,"year":2009},"citing_paper":{"arxiv_id":"2505.17391","last_updated":"2025-05-23T02:01:15Z","snapshot_observed_at":"2026-08-08T00:22:36.393355Z","submitted_at":"2025-05-23T02:01:15Z","title":"Curriculum Guided Reinforcement Learning for Efficient Multi Hop Retrieval Augmented Generation","version":1},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-07T14:53:17.488743Z"},"links":{"citing_paper":"/paper/2505.17391"},"observation_digest":"sha256:3472f721edfdb9924f3deb15dea4fbaaefdb4f1fe44d6c4cfb7d69580e6f18c1","observation_id":"a1ecbf84-b1e2-4cb1-81b1-380c9026e927","resolution":{"observed_at":"2026-08-07T14:53:17.488743Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2503.05592","last_updated":"2025-03-18T08:32:24Z","snapshot_observed_at":"2026-08-15T04:19:26.319323Z","submitted_at":"2025-03-07T17:14:44Z","title":"R1-Searcher: Incentivizing the Search Capability in LLMs via Reinforcement Learning","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2503.05592","snapshot_observed_at":"2026-08-07T14:53:17.564738Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2505.17391","last_updated":"2025-05-23T02:01:15Z","snapshot_observed_at":"2026-08-08T00:22:36.393355Z","submitted_at":"2025-05-23T02:01:15Z","title":"Curriculum Guided Reinforcement Learning for Efficient Multi Hop Retrieval Augmented Generation","version":1},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-08-07T14:53:17.564738Z"},"links":{"cited_paper":"/paper/2503.05592","citing_paper":"/paper/2505.17391"},"observation_digest":"sha256:3a688605c895fa205f3dd040b4267d22469999df7c644a83d84daf266a5b70a5","observation_id":"19d9e024-5b70-459c-b633-df906e7f27db","resolution":{"observed_at":"2026-08-07T14:53:17.564738Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:53:23.334444Z","title":null,"venue":null,"work_id":"88a9a3d0-4a97-42a5-874e-1f3ee5327dee","year":2022},"citing_paper":{"arxiv_id":"2505.17391","last_updated":"2025-05-23T02:01:15Z","snapshot_observed_at":"2026-08-08T00:22:36.393355Z","submitted_at":"2025-05-23T02:01:15Z","title":"Curriculum Guided Reinforcement Learning for Efficient Multi Hop Retrieval Augmented Generation","version":1},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-08-07T14:53:17.624194Z"},"links":{"citing_paper":"/paper/2505.17391"},"observation_digest":"sha256:a87da1c3bbb6797cd13c68dc281698014fbc59bd65bcec43decb6696d3313ced","observation_id":"9c02533a-aa5b-4f7b-93b8-29465bc16538","resolution":{"observed_at":"2026-08-07T14:53:23.405410Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:53:17.699345Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2505.17391","last_updated":"2025-05-23T02:01:15Z","snapshot_observed_at":"2026-08-08T00:22:36.393355Z","submitted_at":"2025-05-23T02:01:15Z","title":"Curriculum Guided Reinforcement Learning for Efficient Multi Hop Retrieval Augmented Generation","version":1},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-08-07T14:53:17.699345Z"},"links":{"citing_paper":"/paper/2505.17391"},"observation_digest":"sha256:b895dff01529665b09f14ca4be2031ca7da625bf19b3b599c81ecc34952f6e3f","observation_id":"18238a6f-699d-4013-90f6-bb9f89e00b9f","resolution":{"observed_at":"2026-08-07T14:53:17.699345Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2501.07861","last_updated":"2025-01-14T05:56:26Z","snapshot_observed_at":"2026-08-15T03:54:54.866456Z","submitted_at":"2025-01-14T05:56:26Z","title":"ReARTeR: Retrieval-Augmented Reasoning with Trustworthy Process Rewarding","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2501.07861","snapshot_observed_at":"2026-08-07T14:53:17.754749Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2505.17391","last_updated":"2025-05-23T02:01:15Z","snapshot_observed_at":"2026-08-08T00:22:36.393355Z","submitted_at":"2025-05-23T02:01:15Z","title":"Curriculum Guided Reinforcement Learning for Efficient Multi Hop Retrieval Augmented Generation","version":1},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-08-07T14:53:17.754749Z"},"links":{"cited_paper":"/paper/2501.07861","citing_paper":"/paper/2505.17391"},"observation_digest":"sha256:c2ed95038e943d18b709ad7599927f153bf12952017363725cd129381d10132e","observation_id":"321085c9-4f35-4d21-b713-e7e67745c6f4","resolution":{"observed_at":"2026-08-07T14:53:17.754749Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2302.13971","last_updated":"2023-02-27T17:11:15Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2023-02-27T17:11:15Z","title":"LLaMA: Open and Efficient Foundation Language Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2302.13971","snapshot_observed_at":"2026-08-07T14:53:17.815854Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.17391","last_updated":"2025-05-23T02:01:15Z","snapshot_observed_at":"2026-08-08T00:22:36.393355Z","submitted_at":"2025-05-23T02:01:15Z","title":"Curriculum Guided Reinforcement Learning for Efficient Multi Hop Retrieval Augmented Generation","version":1},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-08-07T14:53:17.815854Z"},"links":{"cited_paper":"/paper/2302.13971","citing_paper":"/paper/2505.17391"},"observation_digest":"sha256:f3a4fdcbe191f424a0b6fef65e662e48d5ef00a3c9400ad1453cf01070378788","observation_id":"c3e94cf6-26f0-4018-9b7a-e193db2db88c","resolution":{"observed_at":"2026-08-07T14:53:17.815854Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:53:18.020784Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2505.17391","last_updated":"2025-05-23T02:01:15Z","snapshot_observed_at":"2026-08-08T00:22:36.393355Z","submitted_at":"2025-05-23T02:01:15Z","title":"Curriculum Guided Reinforcement Learning for Efficient Multi Hop Retrieval Augmented Generation","version":1},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-08-07T14:53:18.020784Z"},"links":{"citing_paper":"/paper/2505.17391"},"observation_digest":"sha256:666cdaa54fe5a358d41a83f007811be40df6d282cc6ed94a7b99d2188b677ea9","observation_id":"916d120d-5170-44e0-b4d0-780d5773d9de","resolution":{"observed_at":"2026-08-07T14:53:18.020784Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2501.18365","last_updated":"2025-01-30T14:15:09Z","snapshot_observed_at":"2026-08-15T09:12:06.357758Z","submitted_at":"2025-01-30T14:15:09Z","title":"RbFT: Robust Fine-tuning for Retrieval-Augmented Generation against Retrieval Defects","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2501.18365","snapshot_observed_at":"2026-08-07T14:53:18.188311Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2505.17391","last_updated":"2025-05-23T02:01:15Z","snapshot_observed_at":"2026-08-08T00:22:36.393355Z","submitted_at":"2025-05-23T02:01:15Z","title":"Curriculum Guided Reinforcement Learning for Efficient Multi Hop Retrieval Augmented Generation","version":1},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-08-07T14:53:18.188311Z"},"links":{"cited_paper":"/paper/2501.18365","citing_paper":"/paper/2505.17391"},"observation_digest":"sha256:992380040fab141c607602b2ec246b45481d0fb7e34331e7d0fbf767acf1df15","observation_id":"d8a35478-b016-4a68-bffc-6a9a2bed20a5","resolution":{"observed_at":"2026-08-07T14:53:18.188311Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:53:18.349674Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2505.17391","last_updated":"2025-05-23T02:01:15Z","snapshot_observed_at":"2026-08-08T00:22:36.393355Z","submitted_at":"2025-05-23T02:01:15Z","title":"Curriculum Guided Reinforcement Learning for Efficient Multi Hop Retrieval Augmented Generation","version":1},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-08-07T14:53:18.349674Z"},"links":{"citing_paper":"/paper/2505.17391"},"observation_digest":"sha256:ca6a490eaf8beb4d0ee50cd91f093dcda73136a5243e22ca475c3060a2d3a580","observation_id":"55891a1b-3b3e-4c08-8665-50c3132f9d21","resolution":{"observed_at":"2026-08-07T14:53:18.349674Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:53:18.092861Z","title":"Transactions of the Association for Computational Linguistics 10 (2022), 539–554","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2505.17391","last_updated":"2025-05-23T02:01:15Z","snapshot_observed_at":"2026-08-08T00:22:36.393355Z","submitted_at":"2025-05-23T02:01:15Z","title":"Curriculum Guided Reinforcement Learning for Efficient Multi Hop Retrieval Augmented Generation","version":1},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-08-07T14:53:18.092861Z"},"links":{"citing_paper":"/paper/2505.17391"},"observation_digest":"sha256:725d0700bcc12f92800e9741df84cf3ffbff590452af1118ea4b584f413e3040","observation_id":"47b15b4f-cd95-4ed2-b603-d83473942b8c","resolution":{"observed_at":"2026-08-07T14:53:18.092861Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:53:23.167319Z","title":null,"venue":null,"work_id":"c1da1841-4ce6-4145-9ee4-4ef24dbc6c1b","year":null},"citing_paper":{"arxiv_id":"2505.17391","last_updated":"2025-05-23T02:01:15Z","snapshot_observed_at":"2026-08-08T00:22:36.393355Z","submitted_at":"2025-05-23T02:01:15Z","title":"Curriculum Guided Reinforcement Learning for Efficient Multi Hop Retrieval Augmented Generation","version":1},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-08-07T14:53:18.676820Z"},"links":{"citing_paper":"/paper/2505.17391"},"observation_digest":"sha256:ba44bf9374da02b3149521f24d0331e840be1c9d02d7dc731e14e795d1517de0","observation_id":"77b6e025-60f0-4e87-b2be-bce3ce57ab30","resolution":{"observed_at":"2026-08-07T14:53:23.226286Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2406.13629","last_updated":"2025-03-02T00:46:31Z","snapshot_observed_at":"2026-08-12T23:39:07.244890Z","submitted_at":"2024-06-19T15:25:29Z","title":"InstructRAG: Instructing Retrieval-Augmented Generation via Self-Synthesized Rationales","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2406.13629","snapshot_observed_at":"2026-08-07T14:53:18.922190Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.17391","last_updated":"2025-05-23T02:01:15Z","snapshot_observed_at":"2026-08-08T00:22:36.393355Z","submitted_at":"2025-05-23T02:01:15Z","title":"Curriculum Guided Reinforcement Learning for Efficient Multi Hop Retrieval Augmented Generation","version":1},"reference_index":36,"source":"pdf_text","source_observed_at":"2026-08-07T14:53:18.922190Z"},"links":{"cited_paper":"/paper/2406.13629","citing_paper":"/paper/2505.17391"},"observation_digest":"sha256:26b21cccdf45b93e5c98a6807452edeaaa252fb33e5df84e07659800b3fb022b","observation_id":"09d6b472-a2af-41c6-8f5f-444661a4041e","resolution":{"observed_at":"2026-08-07T14:53:18.922190Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:53:23.023498Z","title":null,"venue":null,"work_id":"e0933387-838c-4ece-9f4a-00c4cab74fbe","year":2024},"citing_paper":{"arxiv_id":"2505.17391","last_updated":"2025-05-23T02:01:15Z","snapshot_observed_at":"2026-08-08T00:22:36.393355Z","submitted_at":"2025-05-23T02:01:15Z","title":"Curriculum Guided Reinforcement Learning for Efficient Multi Hop Retrieval Augmented Generation","version":1},"reference_index":37,"source":"pdf_text","source_observed_at":"2026-08-07T14:53:19.060260Z"},"links":{"citing_paper":"/paper/2505.17391"},"observation_digest":"sha256:e481a5e52ce3d6fce2a40415e704b9ae6542e5c42655765f82912a68f30a051d","observation_id":"59bca393-3aa6-4da8-a815-a57238679064","resolution":{"observed_at":"2026-08-07T14:53:23.104104Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2408.17072","last_updated":"2024-12-19T13:16:40Z","snapshot_observed_at":"2026-08-12T22:54:41.589144Z","submitted_at":"2024-08-30T07:57:30Z","title":"MaFeRw: Query Rewriting with Multi-Aspect Feedbacks for Retrieval-Augmented Large Language Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2408.17072","snapshot_observed_at":"2026-08-07T14:53:18.561534Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.17391","last_updated":"2025-05-23T02:01:15Z","snapshot_observed_at":"2026-08-08T00:22:36.393355Z","submitted_at":"2025-05-23T02:01:15Z","title":"Curriculum Guided Reinforcement Learning for Efficient Multi Hop Retrieval Augmented Generation","version":1},"reference_index":38,"source":"pdf_text","source_observed_at":"2026-08-07T14:53:18.561534Z"},"links":{"cited_paper":"/paper/2408.17072","citing_paper":"/paper/2505.17391"},"observation_digest":"sha256:664481a8887ca01631dbae1d83e5e3068d0a53c09e0673e7ef3639feb0ebe476","observation_id":"edf635c5-338a-4c6e-a34b-d64d52fdeecc","resolution":{"observed_at":"2026-08-07T14:53:18.561534Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2505.09388","last_updated":"2025-05-14T13:41:34Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-05-14T13:41:34Z","title":"Qwen3 Technical Report","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2505.09388","snapshot_observed_at":"2026-08-07T14:53:19.287940Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2505.17391","last_updated":"2025-05-23T02:01:15Z","snapshot_observed_at":"2026-08-08T00:22:36.393355Z","submitted_at":"2025-05-23T02:01:15Z","title":"Curriculum Guided Reinforcement Learning for Efficient Multi Hop Retrieval Augmented Generation","version":1},"reference_index":39,"source":"pdf_text","source_observed_at":"2026-08-07T14:53:19.287940Z"},"links":{"cited_paper":"/paper/2505.09388","citing_paper":"/paper/2505.17391"},"observation_digest":"sha256:e3c94f0ad554eda469150f26b5e12903e83c7f69d69489736a652aadd327cdb3","observation_id":"fc66a19d-d994-4fd1-a13a-76c91ce23c71","resolution":{"observed_at":"2026-08-07T14:53:19.287940Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2407.08223","last_updated":"2025-02-27T19:03:36Z","snapshot_observed_at":"2026-08-12T23:24:29.576576Z","submitted_at":"2024-07-11T06:50:19Z","title":"Speculative RAG: Enhancing Retrieval Augmented Generation through Drafting","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2407.08223","snapshot_observed_at":"2026-08-07T14:53:18.791517Z","title":"arXiv preprint arXiv:2407.08223 (2024)","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.17391","last_updated":"2025-05-23T02:01:15Z","snapshot_observed_at":"2026-08-08T00:22:36.393355Z","submitted_at":"2025-05-23T02:01:15Z","title":"Curriculum Guided Reinforcement Learning for Efficient Multi Hop Retrieval Augmented Generation","version":1},"reference_index":40,"source":"pdf_text","source_observed_at":"2026-08-07T14:53:18.791517Z"},"links":{"cited_paper":"/paper/2407.08223","citing_paper":"/paper/2505.17391"},"observation_digest":"sha256:4644147e975bc953eea9e1e7ac48ca2d883e4f645069021076184fac42fce9b2","observation_id":"7e365823-f04e-4598-83f8-2022d759d626","resolution":{"observed_at":"2026-08-07T14:53:18.791517Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1809.09600","last_updated":"2018-09-25T17:28:20Z","snapshot_observed_at":"2026-08-11T10:35:06.989614Z","submitted_at":"2018-09-25T17:28:20Z","title":"HotpotQA: A Dataset for Diverse, Explainable Multi-hop Question Answering","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1809.09600","snapshot_observed_at":"2026-08-07T14:53:19.533782Z","title":null,"venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2505.17391","last_updated":"2025-05-23T02:01:15Z","snapshot_observed_at":"2026-08-08T00:22:36.393355Z","submitted_at":"2025-05-23T02:01:15Z","title":"Curriculum Guided Reinforcement Learning for Efficient Multi Hop Retrieval Augmented Generation","version":1},"reference_index":41,"source":"pdf_text","source_observed_at":"2026-08-07T14:53:19.533782Z"},"links":{"cited_paper":"/paper/1809.09600","citing_paper":"/paper/2505.17391"},"observation_digest":"sha256:a09747820997678b396fcf9a999888097f6cbc7e2e703975059e334179fc7341","observation_id":"7993c6d0-7706-4374-87a1-1ec31fa5a585","resolution":{"observed_at":"2026-08-07T14:53:19.533782Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:53:19.646988Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.17391","last_updated":"2025-05-23T02:01:15Z","snapshot_observed_at":"2026-08-08T00:22:36.393355Z","submitted_at":"2025-05-23T02:01:15Z","title":"Curriculum Guided Reinforcement Learning for Efficient Multi Hop Retrieval Augmented Generation","version":1},"reference_index":42,"source":"pdf_text","source_observed_at":"2026-08-07T14:53:19.646988Z"},"links":{"citing_paper":"/paper/2505.17391"},"observation_digest":"sha256:aed10fb4d63d7997992b03cfa1242c1d795b86f56d4c44aa48df628cc1555c16","observation_id":"a9917a52-7009-40f8-bcc1-74544ed0b1f2","resolution":{"observed_at":"2026-08-07T14:53:19.646988Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2502.13957","last_updated":"2026-05-16T17:37:22Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-02-19T18:56:03Z","title":"Supervising the search process produces reliable and generalizable information-seeking agents","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2502.13957","snapshot_observed_at":"2026-08-07T14:53:19.152641Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2505.17391","last_updated":"2025-05-23T02:01:15Z","snapshot_observed_at":"2026-08-08T00:22:36.393355Z","submitted_at":"2025-05-23T02:01:15Z","title":"Curriculum Guided Reinforcement Learning for Efficient Multi Hop Retrieval Augmented Generation","version":1},"reference_index":43,"source":"pdf_text","source_observed_at":"2026-08-07T14:53:19.152641Z"},"links":{"cited_paper":"/paper/2502.13957","citing_paper":"/paper/2505.17391"},"observation_digest":"sha256:03f452a97746c50b67b0be143845a08fc229138ef2ad93e697a79bb0fa119f9c","observation_id":"4f8dcb8a-9872-4386-a866-3707322b1578","resolution":{"observed_at":"2026-08-07T14:53:19.152641Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2412.06206","last_updated":"2025-04-07T19:47:16Z","snapshot_observed_at":"2026-08-15T05:20:02.640666Z","submitted_at":"2024-12-09T04:56:43Z","title":"SiReRAG: Indexing Similar and Related Information for Multihop Reasoning","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2412.06206","snapshot_observed_at":"2026-08-07T14:53:19.868182Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.17391","last_updated":"2025-05-23T02:01:15Z","snapshot_observed_at":"2026-08-08T00:22:36.393355Z","submitted_at":"2025-05-23T02:01:15Z","title":"Curriculum Guided Reinforcement Learning for Efficient Multi Hop Retrieval Augmented Generation","version":1},"reference_index":44,"source":"pdf_text","source_observed_at":"2026-08-07T14:53:19.868182Z"},"links":{"cited_paper":"/paper/2412.06206","citing_paper":"/paper/2505.17391"},"observation_digest":"sha256:72b0ced224fec26c6e34a4dd3cfbe40b82f3796983d6e575fb3a7c825bb9adc8","observation_id":"add02dd8-6bea-44d8-8831-95acd5e49425","resolution":{"observed_at":"2026-08-07T14:53:19.868182Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:53:19.433996Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2505.17391","last_updated":"2025-05-23T02:01:15Z","snapshot_observed_at":"2026-08-08T00:22:36.393355Z","submitted_at":"2025-05-23T02:01:15Z","title":"Curriculum Guided Reinforcement Learning for Efficient Multi Hop Retrieval Augmented Generation","version":1},"reference_index":45,"source":"pdf_text","source_observed_at":"2026-08-07T14:53:19.433996Z"},"links":{"citing_paper":"/paper/2505.17391"},"observation_digest":"sha256:7dc33965bbb4f6883615f83649577ba177f8ab129774a302d558b4ac694cc164","observation_id":"8c7849ee-c241-4eef-ad19-189d83170679","resolution":{"observed_at":"2026-08-07T14:53:19.433996Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2410.16843","last_updated":"2024-10-22T09:25:21Z","snapshot_observed_at":"2026-08-12T22:17:45.838718Z","submitted_at":"2024-10-22T09:25:21Z","title":"Trustworthy Alignment of Retrieval-Augmented Large Language Models via Reinforcement Learning","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2410.16843","snapshot_observed_at":"2026-08-07T14:53:20.072426Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.17391","last_updated":"2025-05-23T02:01:15Z","snapshot_observed_at":"2026-08-08T00:22:36.393355Z","submitted_at":"2025-05-23T02:01:15Z","title":"Curriculum Guided Reinforcement Learning for Efficient Multi Hop Retrieval Augmented Generation","version":1},"reference_index":46,"source":"pdf_text","source_observed_at":"2026-08-07T14:53:20.072426Z"},"links":{"cited_paper":"/paper/2410.16843","citing_paper":"/paper/2505.17391"},"observation_digest":"sha256:cb77df0ad65e8ce28873e72bc63401342cf448956d88c5622d2b46cb23444a37","observation_id":"4cf87c32-1641-4c6d-9c84-0255a143f85b","resolution":{"observed_at":"2026-08-07T14:53:20.072426Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:53:22.348315Z","title":null,"venue":null,"work_id":"2a54cb03-3803-4c0a-8aec-049d82515663","year":2025},"citing_paper":{"arxiv_id":"2505.17391","last_updated":"2025-05-23T02:01:15Z","snapshot_observed_at":"2026-08-08T00:22:36.393355Z","submitted_at":"2025-05-23T02:01:15Z","title":"Curriculum Guided Reinforcement Learning for Efficient Multi Hop Retrieval Augmented Generation","version":1},"reference_index":47,"source":"pdf_text","source_observed_at":"2026-08-07T14:53:20.165657Z"},"links":{"citing_paper":"/paper/2505.17391"},"observation_digest":"sha256:a3dfd52f7e9a16e54c935048dbbb7e8e53170b05ea08b1d4bf3e324c311e0343","observation_id":"61015e4b-c3d3-4b4c-9cea-7651771fca0c","resolution":{"observed_at":"2026-08-07T14:53:22.936418Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:53:19.763502Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2505.17391","last_updated":"2025-05-23T02:01:15Z","snapshot_observed_at":"2026-08-08T00:22:36.393355Z","submitted_at":"2025-05-23T02:01:15Z","title":"Curriculum Guided Reinforcement Learning for Efficient Multi Hop Retrieval Augmented Generation","version":1},"reference_index":48,"source":"pdf_text","source_observed_at":"2026-08-07T14:53:19.763502Z"},"links":{"citing_paper":"/paper/2505.17391"},"observation_digest":"sha256:dfbf26e3be29cb2b548d4fe49d984c5b704f503b9d8f88121ef8524c41e13ff7","observation_id":"5ebd14fa-6b07-49f2-93f3-889bef9dd74c","resolution":{"observed_at":"2026-08-07T14:53:19.763502Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2502.14245","last_updated":"2025-05-28T01:19:26Z","snapshot_observed_at":"2026-08-15T09:25:20.636032Z","submitted_at":"2025-02-20T04:19:05Z","title":"Mitigating Lost-in-Retrieval Problems in Retrieval Augmented Multi-Hop Question Answering","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2502.14245","snapshot_observed_at":"2026-08-07T14:53:20.422106Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2505.17391","last_updated":"2025-05-23T02:01:15Z","snapshot_observed_at":"2026-08-08T00:22:36.393355Z","submitted_at":"2025-05-23T02:01:15Z","title":"Curriculum Guided Reinforcement Learning for Efficient Multi Hop Retrieval Augmented Generation","version":1},"reference_index":49,"source":"pdf_text","source_observed_at":"2026-08-07T14:53:20.422106Z"},"links":{"cited_paper":"/paper/2502.14245","citing_paper":"/paper/2505.17391"},"observation_digest":"sha256:f9c07ccebdb808e51e3bb9290d86e14226705e752e5f3c359ff8a662dfcd1128","observation_id":"582ed733-6de2-4f9c-95fd-af9fafa867a1","resolution":{"observed_at":"2026-08-07T14:53:20.422106Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2504.21071","last_updated":"2025-04-29T15:25:34Z","snapshot_observed_at":"2026-08-15T05:14:02.771661Z","submitted_at":"2025-04-29T15:25:34Z","title":"Automated Parking Trajectory Generation Using Deep Reinforcement Learning","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2504.21071","snapshot_observed_at":"2026-08-07T14:53:19.979203Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2505.17391","last_updated":"2025-05-23T02:01:15Z","snapshot_observed_at":"2026-08-08T00:22:36.393355Z","submitted_at":"2025-05-23T02:01:15Z","title":"Curriculum Guided Reinforcement Learning for Efficient Multi Hop Retrieval Augmented Generation","version":1},"reference_index":50,"source":"pdf_text","source_observed_at":"2026-08-07T14:53:19.979203Z"},"links":{"cited_paper":"/paper/2504.21071","citing_paper":"/paper/2505.17391"},"observation_digest":"sha256:08fcf7cb8d545338f0e93117b19c30f3e24055f7646b938d50d25115af1caa25","observation_id":"6a95b0a5-e141-4496-a45a-e2b024937985","resolution":{"observed_at":"2026-08-07T14:53:19.979203Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:53:21.527124Z","title":null,"venue":null,"work_id":"80071cee-8488-4e4f-84ba-f28ae93b168d","year":null},"citing_paper":{"arxiv_id":"2505.17391","last_updated":"2025-05-23T02:01:15Z","snapshot_observed_at":"2026-08-08T00:22:36.393355Z","submitted_at":"2025-05-23T02:01:15Z","title":"Curriculum Guided Reinforcement Learning for Efficient Multi Hop Retrieval Augmented Generation","version":1},"reference_index":53,"source":"pdf_text","source_observed_at":"2026-08-07T14:53:20.294213Z"},"links":{"citing_paper":"/paper/2505.17391"},"observation_digest":"sha256:4f536234f427da295be3facaa711d133282b5fdc53bed7ed979cfa86ae030df6","observation_id":"63bece88-7485-4821-a8f2-fd7e0a094ebe","resolution":{"observed_at":"2026-08-07T14:53:21.662213Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:53:18.457966Z","title":"Advances in neural information processing systems 33 (2020), 5776–5788","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2505.17391","last_updated":"2025-05-23T02:01:15Z","snapshot_observed_at":"2026-08-08T00:22:36.393355Z","submitted_at":"2025-05-23T02:01:15Z","title":"Curriculum Guided Reinforcement Learning for Efficient Multi Hop Retrieval Augmented Generation","version":1},"reference_index":2020,"source":"pdf_text","source_observed_at":"2026-08-07T14:53:18.457966Z"},"links":{"citing_paper":"/paper/2505.17391"},"observation_digest":"sha256:5fad7a32b66a70c9551206648db1691a02b1ec7b4ca3b691d689c093ba193cdd","observation_id":"6c8bab39-76e5-4e2c-894e-d32d60b776b5","resolution":{"observed_at":"2026-08-07T14:53:18.457966Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2212.10509","last_updated":"2023-06-23T00:59:13Z","snapshot_observed_at":"2026-08-15T17:29:02.957931Z","submitted_at":"2022-12-20T18:26:34Z","title":"Interleaving Retrieval with Chain-of-Thought Reasoning for Knowledge-Intensive Multi-Step Questions","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2212.10509","snapshot_observed_at":"2026-08-07T14:53:17.953795Z","title":"arXiv preprint arXiv:2212.10509 (2022)","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2505.17391","last_updated":"2025-05-23T02:01:15Z","snapshot_observed_at":"2026-08-08T00:22:36.393355Z","submitted_at":"2025-05-23T02:01:15Z","title":"Curriculum Guided Reinforcement Learning for Efficient Multi Hop Retrieval Augmented Generation","version":1},"reference_index":2022,"source":"pdf_text","source_observed_at":"2026-08-07T14:53:17.953795Z"},"links":{"cited_paper":"/paper/2212.10509","citing_paper":"/paper/2505.17391"},"observation_digest":"sha256:09e55349505ed73cf8c3830ed9e1778518e0b21c5b8f1f771cbe2a16ca509e81","observation_id":"3243b1be-7d22-4a4e-842e-c6cb63247843","resolution":{"observed_at":"2026-08-07T14:53:17.953795Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2409.11585","last_updated":"2025-03-10T17:21:37Z","snapshot_observed_at":"2026-08-15T02:55:13.865095Z","submitted_at":"2024-09-17T22:20:26Z","title":"Advances in APPFL: A Comprehensive and Extensible Federated Learning Framework","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2409.11585","snapshot_observed_at":"2026-08-07T14:53:16.668640Z","title":"arXiv preprint arXiv:2409.11585 (2024)","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.17391","last_updated":"2025-05-23T02:01:15Z","snapshot_observed_at":"2026-08-08T00:22:36.393355Z","submitted_at":"2025-05-23T02:01:15Z","title":"Curriculum Guided Reinforcement Learning for Efficient Multi Hop Retrieval Augmented Generation","version":1},"reference_index":2024,"source":"pdf_text","source_observed_at":"2026-08-07T14:53:16.668640Z"},"links":{"cited_paper":"/paper/2409.11585","citing_paper":"/paper/2505.17391"},"observation_digest":"sha256:762bef8ccba54528dfcbc6f81fee58519fa80c693cfbb0b3090f3840733c8816","observation_id":"9cb2b352-c193-4bf7-b119-c9ad04234e25","resolution":{"observed_at":"2026-08-07T14:53:16.668640Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2504.05339","last_updated":"2025-04-06T01:11:02Z","snapshot_observed_at":"2026-08-11T16:32:02.692637Z","submitted_at":"2025-04-06T01:11:02Z","title":"Optimized Path Planning for Logistics Robots Using Ant Colony Algorithm under Multiple Constraints","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2504.05339","snapshot_observed_at":"2026-08-07T14:53:20.358295Z","title":"arXiv preprint arXiv:2504.05339 (2025)","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2505.17391","last_updated":"2025-05-23T02:01:15Z","snapshot_observed_at":"2026-08-08T00:22:36.393355Z","submitted_at":"2025-05-23T02:01:15Z","title":"Curriculum Guided Reinforcement Learning for Efficient Multi Hop Retrieval Augmented Generation","version":1},"reference_index":2025,"source":"pdf_text","source_observed_at":"2026-08-07T14:53:20.358295Z"},"links":{"cited_paper":"/paper/2504.05339","citing_paper":"/paper/2505.17391"},"observation_digest":"sha256:ef9a907e717322f361f77dd11fb51cfff496b0ae913a43c17b496ea7941ffa2b","observation_id":"c0450736-3660-444e-9301-faa1ea828c0b","resolution":{"observed_at":"2026-08-07T14:53:20.358295Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"paper":{"arxiv_id":"2505.17391","last_updated":"2025-05-23T02:01:15Z","latest_version":1,"primary_category":"cs.CL","snapshot_observed_at":"2026-08-08T00:22:36.393355Z","submitted_at":"2025-05-23T02:01:15Z","title":"Curriculum Guided Reinforcement Learning for Efficient Multi Hop Retrieval Augmented Generation"},"reference_resolution":{"displayed":54,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":53,"verified_exact":1,"verified_fuzzy":0},"total_outbound_references":54},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"thesis":"As of 15 August 2026, this Paper Citation Record lists 54 of 54 outbound references and 3 inbound Pith citation observations for arXiv:2505.17391."}