{"as_of":"2026-08-20T00:16:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:3f41baeadc1961b2f254ad6747b9ade4c8af70f68e95a0797a1f325fb06876ec","coverage":[{"denominator":124,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":100,"source":"paper_references, paper_reference_links","source_observed_at":"2026-05-22T13:34:27.152447Z","state":"measured"},{"denominator":101,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":101,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-19T06:32:44.657259+00:00","state":"measured"},{"denominator":1,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":1,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-01T16:10:06.564268Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2505.17086","last_updated":"2026-04-14T00:27:30Z","snapshot_observed_at":"2026-08-14T10:49:19.013711Z","submitted_at":"2025-05-20T18:33:03Z","title":"Advancing Multi-Agent RAG Systems with Minimalist Reinforcement Learning","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2505.17086","snapshot_observed_at":"2026-08-01T16:10:06.564268Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.18102","last_updated":"2026-07-21T15:53:04Z","snapshot_observed_at":"2026-08-17T04:16:00.615509Z","submitted_at":"2026-07-20T16:03:15Z","title":"FinSAgent: Corpus-Aligned Multi-Agent RAG Framework for Evidence-Grounded SEC Filing Question Answering","version":2},"reference_index":42,"source":"pdf_text","source_observed_at":"2026-08-01T16:10:06.564268Z"},"links":{"cited_paper":"/paper/2505.17086","citing_paper":"/paper/2607.18102"},"observation_digest":"sha256:3ee0fd86c67b21f8c0acaf20cf48b93b2091299d9b67e36bac47d8c2297357cc","observation_id":"e41afb32-9fe0-4b29-b785-a5a74478efa8","resolution":{"observed_at":"2026-08-01T16:10:06.564268Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"links":{"evidence":"/evidence","html":"/paper/2505.17086/citation-record","integrity":"/paper/2505.17086/integrity","json":"/paper/2505.17086/citation-record.json","paper":"/paper/2505.17086"},"outbound":[{"citation":{"cited_paper":{"arxiv_id":"2303.08774","last_updated":"2024-03-04T06:01:33Z","snapshot_observed_at":"2026-08-17T09:58:46.058102Z","submitted_at":"2023-03-15T17:15:04Z","title":"GPT-4 Technical Report","version":6},"cited_work":{"arxiv_id":"2303.08774","doi":"10.1002/tea.20265","metadata_source":"pith","pith_arxiv_id":"2303.08774","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"GPT-4 Technical Report","venue":"cs.CL","work_id":"b928e041-6991-4c08-8c81-0359e4097c7b","year":2023},"citing_paper":{"arxiv_id":"2505.17086","last_updated":"2026-04-14T00:27:30Z","snapshot_observed_at":"2026-08-14T10:49:19.013711Z","submitted_at":"2025-05-20T18:33:03Z","title":"Advancing Multi-Agent RAG Systems with Minimalist Reinforcement Learning","version":4},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-05-22T13:34:27.152447Z"},"links":{"cited_paper":"/paper/2303.08774","citing_paper":"/paper/2505.17086"},"observation_digest":"sha256:9257b8488942ca8e30d2dc17319e4ea067a253b19deb0f23c4b9cce387a1909f","observation_id":"c3e53cb1-ebd0-4c7c-a552-6bda95b151f5","resolution":{"observed_at":"2026-05-22T13:34:53.061140Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":"10.18653/v1/2024.acl-long.545","metadata_source":"openalex","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":null,"venue":null,"work_id":"7cf4a055-ad77-4d39-93f2-5fdfb3479844","year":2024},"citing_paper":{"arxiv_id":"2505.17086","last_updated":"2026-04-14T00:27:30Z","snapshot_observed_at":"2026-08-14T10:49:19.013711Z","submitted_at":"2025-05-20T18:33:03Z","title":"Advancing Multi-Agent RAG Systems with Minimalist Reinforcement Learning","version":4},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-05-22T13:34:27.152447Z"},"links":{"citing_paper":"/paper/2505.17086"},"observation_digest":"sha256:30696b5213bc17651ccfe3825ec1a59692adbb898257545235c18a1820bde64a","observation_id":"6dc05c2c-9f56-41f0-b7e8-0a2e8ebbcf8c","resolution":{"observed_at":"2026-05-22T13:34:52.958724Z","resolver_source":"doi","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":null,"venue":null,"work_id":"1247660a-e843-46ec-af8c-cd8a0a462c49","year":2023},"citing_paper":{"arxiv_id":"2505.17086","last_updated":"2026-04-14T00:27:30Z","snapshot_observed_at":"2026-08-14T10:49:19.013711Z","submitted_at":"2025-05-20T18:33:03Z","title":"Advancing Multi-Agent RAG Systems with Minimalist Reinforcement Learning","version":4},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-05-22T13:34:27.152447Z"},"links":{"citing_paper":"/paper/2505.17086"},"observation_digest":"sha256:570bb0145b92c5599420f6fcefc395b367a588f0f27c07b51335d9458cf09580","observation_id":"93076ea8-79f7-4b33-8cf8-bf66412e49af","resolution":{"observed_at":"2026-05-22T13:34:54.010025Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2402.14740","last_updated":"2024-02-26T18:26:25Z","snapshot_observed_at":"2026-08-09T14:30:33.899591Z","submitted_at":"2024-02-22T17:52:34Z","title":"Back to Basics: Revisiting REINFORCE Style Optimization for Learning from Human Feedback in LLMs","version":2},"cited_work":{"arxiv_id":"2402.14740","doi":null,"metadata_source":"pith","pith_arxiv_id":"2402.14740","snapshot_observed_at":"2026-07-09T08:56:06.435604Z","title":"Back to Basics: Revisiting REINFORCE Style Optimization for Learning from Human Feedback in LLMs","venue":"cs.LG","work_id":"7bb8f9ec-1241-4472-a4fa-c636c6d79892","year":2024},"citing_paper":{"arxiv_id":"2505.17086","last_updated":"2026-04-14T00:27:30Z","snapshot_observed_at":"2026-08-14T10:49:19.013711Z","submitted_at":"2025-05-20T18:33:03Z","title":"Advancing Multi-Agent RAG Systems with Minimalist Reinforcement Learning","version":4},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-05-22T13:34:27.152447Z"},"links":{"cited_paper":"/paper/2402.14740","citing_paper":"/paper/2505.17086"},"observation_digest":"sha256:30c6343172fb30a9789643f917369f2b5dfe9222d7fa312d958954823d19850f","observation_id":"aa9543ae-9ede-448c-9588-cd8323be6273","resolution":{"observed_at":"2026-05-22T13:34:53.062849Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-09T08:46:06.874657Z","title":null,"venue":null,"work_id":"7789f786-76d0-4cc1-b01d-adfe8d140e8f","year":null},"citing_paper":{"arxiv_id":"2505.17086","last_updated":"2026-04-14T00:27:30Z","snapshot_observed_at":"2026-08-14T10:49:19.013711Z","submitted_at":"2025-05-20T18:33:03Z","title":"Advancing Multi-Agent RAG Systems with Minimalist Reinforcement Learning","version":4},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-05-22T13:34:27.152447Z"},"links":{"citing_paper":"/paper/2505.17086"},"observation_digest":"sha256:9fe116841a56484c1e1790afc3d588960b37c8370d7d7eec7289a52735903874","observation_id":"01b51e4e-a9d4-4bbe-a3ac-1753bdbd0614","resolution":{"observed_at":"2026-05-22T13:34:53.986081Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"InThe Twelfth International Conference on Learning Representations","venue":null,"work_id":"ac609627-1a42-4546-9123-4e81f9914025","year":null},"citing_paper":{"arxiv_id":"2505.17086","last_updated":"2026-04-14T00:27:30Z","snapshot_observed_at":"2026-08-14T10:49:19.013711Z","submitted_at":"2025-05-20T18:33:03Z","title":"Advancing Multi-Agent RAG Systems with Minimalist Reinforcement Learning","version":4},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-05-22T13:34:27.152447Z"},"links":{"citing_paper":"/paper/2505.17086"},"observation_digest":"sha256:fd84bfe3e63cce46f64a5d6c38883a91cb6016b553bee863884ff99ffed757e4","observation_id":"a5eb2931-e5ad-4230-b801-0a29a7ff016a","resolution":{"observed_at":"2026-05-22T13:34:53.999681Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1606.01540","last_updated":"2016-06-05T17:54:48Z","snapshot_observed_at":"2026-08-13T12:26:05.192883Z","submitted_at":"2016-06-05T17:54:48Z","title":"OpenAI Gym","version":1},"cited_work":{"arxiv_id":"1606.01540","doi":"10.1109/jssc.2019","metadata_source":"pith","pith_arxiv_id":"1606.01540","snapshot_observed_at":"2026-07-11T11:50:26.030339Z","title":"OpenAI Gym","venue":"cs.LG","work_id":"6af98f3f-f074-41ae-a689-7dd7b4b8efde","year":2016},"citing_paper":{"arxiv_id":"2505.17086","last_updated":"2026-04-14T00:27:30Z","snapshot_observed_at":"2026-08-14T10:49:19.013711Z","submitted_at":"2025-05-20T18:33:03Z","title":"Advancing Multi-Agent RAG Systems with Minimalist Reinforcement Learning","version":4},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-05-22T13:34:27.152447Z"},"links":{"cited_paper":"/paper/1606.01540","citing_paper":"/paper/2505.17086"},"observation_digest":"sha256:6141ffebca486f28f28cf64c4e0a65ca9e35f686949eb6942adf5434e793c559","observation_id":"ec28b629-adad-41dc-8d0f-e5676fc14723","resolution":{"observed_at":"2026-05-22T13:34:53.040650Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":null,"venue":null,"work_id":"cba17096-9394-4580-9be9-e3f4b6af1417","year":2024},"citing_paper":{"arxiv_id":"2505.17086","last_updated":"2026-04-14T00:27:30Z","snapshot_observed_at":"2026-08-14T10:49:19.013711Z","submitted_at":"2025-05-20T18:33:03Z","title":"Advancing Multi-Agent RAG Systems with Minimalist Reinforcement Learning","version":4},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-05-22T13:34:27.152447Z"},"links":{"citing_paper":"/paper/2505.17086"},"observation_digest":"sha256:501b1f855b20a5530ef0fca9fd14f1c6a30fc5175fd99af49eada83f5e29cec7","observation_id":"4bbf7ae1-2004-4a1b-b8d3-4ed828463337","resolution":{"observed_at":"2026-05-22T13:34:54.006338Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-08T18:25:26.397231Z","title":null,"venue":null,"work_id":"ef350748-fad7-41ba-a8c3-2be10bfcd6c3","year":null},"citing_paper":{"arxiv_id":"2505.17086","last_updated":"2026-04-14T00:27:30Z","snapshot_observed_at":"2026-08-14T10:49:19.013711Z","submitted_at":"2025-05-20T18:33:03Z","title":"Advancing Multi-Agent RAG Systems with Minimalist Reinforcement Learning","version":4},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-05-22T13:34:27.152447Z"},"links":{"citing_paper":"/paper/2505.17086"},"observation_digest":"sha256:8f834ba6fab9d166f910410636b1b2db39d4d2dd44a61111cc798c31f289ffdb","observation_id":"f570b6a2-2d4e-4191-b922-26e98f6ac7be","resolution":{"observed_at":"2026-05-22T13:34:53.990196Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2402.03216","last_updated":"2025-12-12T11:26:32Z","snapshot_observed_at":"2026-08-17T15:25:09.479397Z","submitted_at":"2024-02-05T17:26:49Z","title":"M3-Embedding: Multi-Linguality, Multi-Functionality, Multi-Granularity Text Embeddings Through Self-Knowledge Distillation","version":5},"cited_work":{"arxiv_id":"2402.03216","doi":"10.48550/arxiv.2402.03216","metadata_source":"pith","pith_arxiv_id":"2402.03216","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"M3-Embedding: Multi-Linguality, Multi-Functionality, Multi-Granularity Text Embeddings Through Self-Knowledge Distillation","venue":"cs.CL","work_id":"a9435752-4e49-42bd-95b4-0fec975633c8","year":2024},"citing_paper":{"arxiv_id":"2505.17086","last_updated":"2026-04-14T00:27:30Z","snapshot_observed_at":"2026-08-14T10:49:19.013711Z","submitted_at":"2025-05-20T18:33:03Z","title":"Advancing Multi-Agent RAG Systems with Minimalist Reinforcement Learning","version":4},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-05-22T13:34:27.152447Z"},"links":{"cited_paper":"/paper/2402.03216","citing_paper":"/paper/2505.17086"},"observation_digest":"sha256:3b408952b692a86598265e31d763b15c2c764d88d54303695a94eedf0dfafa03","observation_id":"32f1a6da-88fd-4f65-860d-6eda1a50d85c","resolution":{"observed_at":"2026-05-22T13:34:53.051298Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-13T18:38:56.206531+00:00","source":"crossref_status_cache"},{"observed_at":"2026-08-13T18:38:56.206531+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":null,"venue":null,"work_id":"8f21fa04-f943-41d5-ade3-39985b82d491","year":null},"citing_paper":{"arxiv_id":"2505.17086","last_updated":"2026-04-14T00:27:30Z","snapshot_observed_at":"2026-08-14T10:49:19.013711Z","submitted_at":"2025-05-20T18:33:03Z","title":"Advancing Multi-Agent RAG Systems with Minimalist Reinforcement Learning","version":4},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-05-22T13:34:27.152447Z"},"links":{"citing_paper":"/paper/2505.17086"},"observation_digest":"sha256:77c3e24eb9d5137d3425683064455fd68697b8ef31ee3cfc86244dd603d4bfed","observation_id":"1bba08f2-eb2a-4215-8203-97923389cd04","resolution":{"observed_at":"2026-05-22T13:34:54.003246Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"InThe Thirty-eighth Annual Conference on Neural Information Processing Systems","venue":null,"work_id":"54a402fd-6278-4929-be78-3572086382d8","year":null},"citing_paper":{"arxiv_id":"2505.17086","last_updated":"2026-04-14T00:27:30Z","snapshot_observed_at":"2026-08-14T10:49:19.013711Z","submitted_at":"2025-05-20T18:33:03Z","title":"Advancing Multi-Agent RAG Systems with Minimalist Reinforcement Learning","version":4},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-05-22T13:34:27.152447Z"},"links":{"citing_paper":"/paper/2505.17086"},"observation_digest":"sha256:f2e2039b6e6103cf02f43f393efbe4b4529a5b0462bfc34f1d18eabe49b0d290","observation_id":"76164afb-cf1e-4624-97a1-f7e57cfb2728","resolution":{"observed_at":"2026-05-22T13:34:53.992553Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2503.19470","last_updated":"2025-09-23T03:45:42Z","snapshot_observed_at":"2026-08-17T01:02:33.957223Z","submitted_at":"2025-03-25T09:00:58Z","title":"ReSearch: Learning to Reason with Search for LLMs via Reinforcement Learning","version":3},"cited_work":{"arxiv_id":"2503.19470","doi":"10.48550/arxiv.2503.19470","metadata_source":"pith","pith_arxiv_id":"2503.19470","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"ReSearch: Learning to Reason with Search for LLMs via Reinforcement Learning","venue":"cs.AI","work_id":"cc9775d9-2fbd-4690-a641-2b50ae4a59dc","year":2025},"citing_paper":{"arxiv_id":"2505.17086","last_updated":"2026-04-14T00:27:30Z","snapshot_observed_at":"2026-08-14T10:49:19.013711Z","submitted_at":"2025-05-20T18:33:03Z","title":"Advancing Multi-Agent RAG Systems with Minimalist Reinforcement Learning","version":4},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-05-22T13:34:27.152447Z"},"links":{"cited_paper":"/paper/2503.19470","citing_paper":"/paper/2505.17086"},"observation_digest":"sha256:598a34512689588b0543a1291645ddde426c87b84577840831a3853b0726d5bb","observation_id":"456cff23-58e2-4a7a-8438-ba2ca4ebc2d5","resolution":{"observed_at":"2026-05-22T13:34:53.029691Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2403.12958","last_updated":"2024-09-17T17:25:40Z","snapshot_observed_at":"2026-08-18T20:48:08.567547Z","submitted_at":"2024-03-19T17:57:58Z","title":"Dated Data: Tracing Knowledge Cutoffs in Large Language Models","version":2},"cited_work":{"arxiv_id":"2403.12958","doi":"10.48550/arxiv.2403.12958","metadata_source":"arxiv_reference","pith_arxiv_id":"2403.12958","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Dated data: Tracing knowledge cutoffs in large language models","venue":"arXiv (Cornell University)","work_id":"42f5f09c-2a88-48ad-bf87-387d0cac0d06","year":2024},"citing_paper":{"arxiv_id":"2505.17086","last_updated":"2026-04-14T00:27:30Z","snapshot_observed_at":"2026-08-14T10:49:19.013711Z","submitted_at":"2025-05-20T18:33:03Z","title":"Advancing Multi-Agent RAG Systems with Minimalist Reinforcement Learning","version":4},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-05-22T13:34:27.152447Z"},"links":{"cited_paper":"/paper/2403.12958","citing_paper":"/paper/2505.17086"},"observation_digest":"sha256:f3ae19620fe3b3c77f0b7e70c316728ee50e75394d090aa3e2e897c2d6ac3ff0","observation_id":"faf063fb-933e-4f29-9580-ed20e2ca9024","resolution":{"observed_at":"2026-05-22T13:34:53.057256Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"2504.02546","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-04T09:09:43.573095Z","title":"arXiv preprint arXiv:2504.02546 , year=","venue":null,"work_id":"cdcdaf53-666f-4c7f-8a7f-df8e9b3a4c49","year":2025},"citing_paper":{"arxiv_id":"2505.17086","last_updated":"2026-04-14T00:27:30Z","snapshot_observed_at":"2026-08-14T10:49:19.013711Z","submitted_at":"2025-05-20T18:33:03Z","title":"Advancing Multi-Agent RAG Systems with Minimalist Reinforcement Learning","version":4},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-05-22T13:34:27.152447Z"},"links":{"citing_paper":"/paper/2505.17086"},"observation_digest":"sha256:51d882f7d45d31396d3fa8b36876f79a7b56a59c9f810156ec24a88b329ad3ab","observation_id":"fff636c9-9793-4b52-a103-0b4dfef09d6c","resolution":{"observed_at":"2026-05-22T13:34:53.058095Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":null,"venue":null,"work_id":"f6ddd3e4-221d-44be-af66-843232499a4b","year":2023},"citing_paper":{"arxiv_id":"2505.17086","last_updated":"2026-04-14T00:27:30Z","snapshot_observed_at":"2026-08-14T10:49:19.013711Z","submitted_at":"2025-05-20T18:33:03Z","title":"Advancing Multi-Agent RAG Systems with Minimalist Reinforcement Learning","version":4},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-05-22T13:34:27.152447Z"},"links":{"citing_paper":"/paper/2505.17086"},"observation_digest":"sha256:d724436080cdc5dc3727a20a5141d1e7c9d7f78706e241473ecebf346afe9c31","observation_id":"9161d51e-b540-4c18-aa5c-7d6787dd2450","resolution":{"observed_at":"2026-05-22T13:34:53.952111Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":"10.18653/v1/2024.emnlp-main.64","metadata_source":"openalex","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"A Survey on In-context Learning","venue":null,"work_id":"a881a941-300a-48ff-aa5c-99d2559ddfcb","year":2024},"citing_paper":{"arxiv_id":"2505.17086","last_updated":"2026-04-14T00:27:30Z","snapshot_observed_at":"2026-08-14T10:49:19.013711Z","submitted_at":"2025-05-20T18:33:03Z","title":"Advancing Multi-Agent RAG Systems with Minimalist Reinforcement Learning","version":4},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-05-22T13:34:27.152447Z"},"links":{"citing_paper":"/paper/2505.17086"},"observation_digest":"sha256:89f7e88e13745a9971f91456c9b7973e6ab730bd3120d5d9d6570c4d087cafa7","observation_id":"c39c1b8c-2f08-45ac-adf2-f8a89e69adc1","resolution":{"observed_at":"2026-05-22T13:34:52.894610Z","resolver_source":"doi","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-07-11T03:18:52.818767+00:00","source":"crossref_status_cache"},{"observed_at":"2026-07-11T03:18:52.818767+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2412.20995","last_updated":"2024-12-30T14:58:46Z","snapshot_observed_at":"2026-08-18T17:10:45.706834Z","submitted_at":"2024-12-30T14:58:46Z","title":"KARPA: A Training-free Method of Adapting Knowledge Graph as References for Large Language Model's Reasoning Path Aggregation","version":1},"cited_work":{"arxiv_id":"2412.20995","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2412.20995","snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Qingyu Guo, Fuzhen Zhuang, Chuan Qin, Hengshu Zhu, Xing Xie, Hui Xiong, and Qing He","venue":null,"work_id":"163c964b-eaa3-43ec-b45c-941dc457bb9e","year":2024},"citing_paper":{"arxiv_id":"2505.17086","last_updated":"2026-04-14T00:27:30Z","snapshot_observed_at":"2026-08-14T10:49:19.013711Z","submitted_at":"2025-05-20T18:33:03Z","title":"Advancing Multi-Agent RAG Systems with Minimalist Reinforcement Learning","version":4},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-05-22T13:34:27.152447Z"},"links":{"cited_paper":"/paper/2412.20995","citing_paper":"/paper/2505.17086"},"observation_digest":"sha256:81eb0d38434c10be810c3dc5de174640c4bea9aadbf5dbab0ab86f36484b6b9a","observation_id":"eaec61d6-1d0f-46a3-98ab-27af44397d12","resolution":{"observed_at":"2026-05-22T13:34:53.184917Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-10T01:36:44.806431Z","title":null,"venue":null,"work_id":"bc431a76-e7c8-439d-a773-74519111076f","year":null},"citing_paper":{"arxiv_id":"2505.17086","last_updated":"2026-04-14T00:27:30Z","snapshot_observed_at":"2026-08-14T10:49:19.013711Z","submitted_at":"2025-05-20T18:33:03Z","title":"Advancing Multi-Agent RAG Systems with Minimalist Reinforcement Learning","version":4},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-05-22T13:34:27.152447Z"},"links":{"citing_paper":"/paper/2505.17086"},"observation_digest":"sha256:d8b8de541bad2e5f4e68db2a19b01bad766a273890d7fee792cf9201ce752402","observation_id":"8fde6133-fb66-4a08-948f-12c5074c1553","resolution":{"observed_at":"2026-05-22T13:34:53.962160Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"InThe Thirty-eighth Annual Conference on Neural Information Processing Systems","venue":null,"work_id":"63e88528-4a07-4f58-9701-c5b9cd347e4c","year":null},"citing_paper":{"arxiv_id":"2505.17086","last_updated":"2026-04-14T00:27:30Z","snapshot_observed_at":"2026-08-14T10:49:19.013711Z","submitted_at":"2025-05-20T18:33:03Z","title":"Advancing Multi-Agent RAG Systems with Minimalist Reinforcement Learning","version":4},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-05-22T13:34:27.152447Z"},"links":{"citing_paper":"/paper/2505.17086"},"observation_digest":"sha256:713fbf73e1bdb46083255c91ec744ed4fc5ac239afbba0f6cfe974888b380e68","observation_id":"b500ae7e-ec51-4adb-b5c3-057a6578b8ca","resolution":{"observed_at":"2026-05-22T13:34:53.944975Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":null,"venue":null,"work_id":"303c96ab-6369-4c0a-92c8-be8c3c85c6b4","year":2020},"citing_paper":{"arxiv_id":"2505.17086","last_updated":"2026-04-14T00:27:30Z","snapshot_observed_at":"2026-08-14T10:49:19.013711Z","submitted_at":"2025-05-20T18:33:03Z","title":"Advancing Multi-Agent RAG Systems with Minimalist Reinforcement Learning","version":4},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-05-22T13:34:27.152447Z"},"links":{"citing_paper":"/paper/2505.17086"},"observation_digest":"sha256:8c9c69d64e7a114b47faf130c24bbb138c1802de4a14881f104151c403e8dad0","observation_id":"d6ea4b75-c922-4497-96ea-316c910e668f","resolution":{"observed_at":"2026-05-22T13:34:53.811901Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":"10.18653/v1/2020.coling-main.580","metadata_source":"doi_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-03T19:08:49.111773Z","title":"Constructing A Multi-hop QA Dataset for Comprehensive Evaluation of Reasoning Steps","venue":"Proceedings of the 28th International Conference on Computational Linguistics","work_id":"fd3a2c44-aeea-48a7-b162-d3f0c6d43f35","year":2020},"citing_paper":{"arxiv_id":"2505.17086","last_updated":"2026-04-14T00:27:30Z","snapshot_observed_at":"2026-08-14T10:49:19.013711Z","submitted_at":"2025-05-20T18:33:03Z","title":"Advancing Multi-Agent RAG Systems with Minimalist Reinforcement Learning","version":4},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-05-22T13:34:27.152447Z"},"links":{"citing_paper":"/paper/2505.17086"},"observation_digest":"sha256:541e5de6dddd178558ca6089f13558c3b34451018bf1c6c41ffbc1b64afebd78","observation_id":"ffb0c239-8923-4143-81bc-c8b25d934b43","resolution":{"observed_at":"2026-05-22T13:34:52.929135Z","resolver_source":"doi","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-08T13:08:16.411745+00:00","source":"crossref_status_cache"},{"observed_at":"2026-08-08T13:08:16.411745+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2501.03262","last_updated":"2025-11-10T15:11:13Z","snapshot_observed_at":"2026-08-16T04:57:30.418363Z","submitted_at":"2025-01-04T02:08:06Z","title":"REINFORCE++: Stabilizing Critic-Free Policy Optimization with Global Advantage Normalization","version":9},"cited_work":{"arxiv_id":"2501.03262","doi":"10.48550/arxiv.2501.03262","metadata_source":"pith","pith_arxiv_id":"2501.03262","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"REINFORCE++: Stabilizing Critic-Free Policy Optimization with Global Advantage Normalization","venue":"cs.CL","work_id":"557f9e99-cb00-4dd2-92fd-67ddcddbb35d","year":2025},"citing_paper":{"arxiv_id":"2505.17086","last_updated":"2026-04-14T00:27:30Z","snapshot_observed_at":"2026-08-14T10:49:19.013711Z","submitted_at":"2025-05-20T18:33:03Z","title":"Advancing Multi-Agent RAG Systems with Minimalist Reinforcement Learning","version":4},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-05-22T13:34:27.152447Z"},"links":{"cited_paper":"/paper/2501.03262","citing_paper":"/paper/2505.17086"},"observation_digest":"sha256:69abcf0d9b9100f9b4faeaf20dcdc64067d94f555763436e4655eea9695e6ede","observation_id":"2307f248-44f0-46bb-bef2-5198833b060a","resolution":{"observed_at":"2026-05-22T13:34:53.166475Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-15T03:08:16.02596+00:00","source":"crossref_status_cache"},{"observed_at":"2026-08-15T03:08:16.02596+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-07T08:23:30.898891Z","title":null,"venue":null,"work_id":"5f463bfb-dce6-41dc-8293-b0fe5356b531","year":2025},"citing_paper":{"arxiv_id":"2505.17086","last_updated":"2026-04-14T00:27:30Z","snapshot_observed_at":"2026-08-14T10:49:19.013711Z","submitted_at":"2025-05-20T18:33:03Z","title":"Advancing Multi-Agent RAG Systems with Minimalist Reinforcement Learning","version":4},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-05-22T13:34:27.152447Z"},"links":{"citing_paper":"/paper/2505.17086"},"observation_digest":"sha256:5bbd83e5fd2aadf44527be4b60abe867c7308f013cb29d95c7b7b739ad1b2d15","observation_id":"429b2595-7e4a-4a30-8ec5-e728865091ea","resolution":{"observed_at":"2026-05-22T13:34:53.971769Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":null,"venue":null,"work_id":"d545c0bd-5774-4cf3-a3fb-962ba0182970","year":2025},"citing_paper":{"arxiv_id":"2505.17086","last_updated":"2026-04-14T00:27:30Z","snapshot_observed_at":"2026-08-14T10:49:19.013711Z","submitted_at":"2025-05-20T18:33:03Z","title":"Advancing Multi-Agent RAG Systems with Minimalist Reinforcement Learning","version":4},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-05-22T13:34:27.152447Z"},"links":{"citing_paper":"/paper/2505.17086"},"observation_digest":"sha256:711429229d59a80b089147fb5ce19589972e7fae7b839d5b9b8b45c47c42e828","observation_id":"ef8452ae-cf20-44da-afa6-ddf1ba77f78a","resolution":{"observed_at":"2026-05-22T13:34:53.937671Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2407.13101","last_updated":"2025-01-30T04:51:41Z","snapshot_observed_at":"2026-08-18T13:55:47.375118Z","submitted_at":"2024-07-18T02:19:00Z","title":"Retrieve, Summarize, Plan: Advancing Multi-hop Question Answering with an Iterative Approach","version":2},"cited_work":{"arxiv_id":"2407.13101","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2407.13101","snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Retrieve, summarize, plan: Advancing multi-hop question answering with an iterative approach","venue":null,"work_id":"3aeecbd4-db5a-4642-8e8c-35a75bc24045","year":2025},"citing_paper":{"arxiv_id":"2505.17086","last_updated":"2026-04-14T00:27:30Z","snapshot_observed_at":"2026-08-14T10:49:19.013711Z","submitted_at":"2025-05-20T18:33:03Z","title":"Advancing Multi-Agent RAG Systems with Minimalist Reinforcement Learning","version":4},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-05-22T13:34:27.152447Z"},"links":{"cited_paper":"/paper/2407.13101","citing_paper":"/paper/2505.17086"},"observation_digest":"sha256:c46d16ffc4b1c63451dc12241c4df8b4f84a400735df5836e2f8a2f39b3d892f","observation_id":"187474a9-8226-4269-b1ea-7866cf7a20c0","resolution":{"observed_at":"2026-05-22T13:34:53.200359Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-09T11:26:12.355423Z","title":null,"venue":null,"work_id":"bd28195d-ffb0-4a09-8e4f-ee408da3bd25","year":2020},"citing_paper":{"arxiv_id":"2505.17086","last_updated":"2026-04-14T00:27:30Z","snapshot_observed_at":"2026-08-14T10:49:19.013711Z","submitted_at":"2025-05-20T18:33:03Z","title":"Advancing Multi-Agent RAG Systems with Minimalist Reinforcement Learning","version":4},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-05-22T13:34:27.152447Z"},"links":{"citing_paper":"/paper/2505.17086"},"observation_digest":"sha256:454db3dc39ca34ad648ef4e095e6418e7c7605199e0167d5fa0c88510d1b62fe","observation_id":"6190740c-e0af-424d-9612-f0160913ae45","resolution":{"observed_at":"2026-05-22T13:34:53.760445Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2212.14024","last_updated":"2023-01-23T17:00:01Z","snapshot_observed_at":"2026-08-16T16:05:35.248659Z","submitted_at":"2022-12-28T18:52:44Z","title":"Demonstrate-Search-Predict: Composing retrieval and language models for knowledge-intensive NLP","version":2},"cited_work":{"arxiv_id":"2212.14024","doi":"10.48550/arxiv.2212.14024","metadata_source":"pith","pith_arxiv_id":"2212.14024","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Demonstrate-search-predict: Composing retrieval and language models for knowledge-intensive nlp","venue":"cs.CL","work_id":"8d4545f4-9530-4521-8def-7d279b7c0dd8","year":2022},"citing_paper":{"arxiv_id":"2505.17086","last_updated":"2026-04-14T00:27:30Z","snapshot_observed_at":"2026-08-14T10:49:19.013711Z","submitted_at":"2025-05-20T18:33:03Z","title":"Advancing Multi-Agent RAG Systems with Minimalist Reinforcement Learning","version":4},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-05-22T13:34:27.152447Z"},"links":{"cited_paper":"/paper/2212.14024","citing_paper":"/paper/2505.17086"},"observation_digest":"sha256:f10ebc85f536d8ea105fa2516f96d00ff6dae7c47182d74d484e907a7f1b3821","observation_id":"a6235a94-d23e-4e13-a5a9-72ac6907191e","resolution":{"observed_at":"2026-05-22T13:34:53.191442Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-06T23:13:03.714466Z","title":null,"venue":null,"work_id":"8e1a9aba-d698-49e6-912c-5fe5fa49f673","year":2017},"citing_paper":{"arxiv_id":"2505.17086","last_updated":"2026-04-14T00:27:30Z","snapshot_observed_at":"2026-08-14T10:49:19.013711Z","submitted_at":"2025-05-20T18:33:03Z","title":"Advancing Multi-Agent RAG Systems with Minimalist Reinforcement Learning","version":4},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-05-22T13:34:27.152447Z"},"links":{"citing_paper":"/paper/2505.17086"},"observation_digest":"sha256:e75f6b9738350a490a208653d4baedfc90bcee2673247a41adeb552b8586f9fe","observation_id":"ac6c86e8-7876-4b6d-a40b-1922c4f3ca56","resolution":{"observed_at":"2026-05-22T13:34:53.931263Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-05T22:31:29.345190Z","title":null,"venue":null,"work_id":"4dc5956c-6b7f-44a0-b648-46d27c5f6eed","year":2023},"citing_paper":{"arxiv_id":"2505.17086","last_updated":"2026-04-14T00:27:30Z","snapshot_observed_at":"2026-08-14T10:49:19.013711Z","submitted_at":"2025-05-20T18:33:03Z","title":"Advancing Multi-Agent RAG Systems with Minimalist Reinforcement Learning","version":4},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-05-22T13:34:27.152447Z"},"links":{"citing_paper":"/paper/2505.17086"},"observation_digest":"sha256:aae3c1f9c22aec22f1bc3df9b95ec4374a2d63e5f19390109023a94a50c8790d","observation_id":"65f74364-8890-4880-8755-7d7620c686bd","resolution":{"observed_at":"2026-05-22T13:34:53.880531Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":"10.18653/v1/2020.acl-main.91","metadata_source":"openalex","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Query graph generation for answering multi-hop complex questions from knowledge bases","venue":null,"work_id":"e10c9185-c581-4a67-aa51-3acebdbbc05d","year":2020},"citing_paper":{"arxiv_id":"2505.17086","last_updated":"2026-04-14T00:27:30Z","snapshot_observed_at":"2026-08-14T10:49:19.013711Z","submitted_at":"2025-05-20T18:33:03Z","title":"Advancing Multi-Agent RAG Systems with Minimalist Reinforcement Learning","version":4},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-05-22T13:34:27.152447Z"},"links":{"citing_paper":"/paper/2505.17086"},"observation_digest":"sha256:94343a465a3e2b86a8a2c99af72c709a701ffa366c172a765c73bd179b00b399","observation_id":"0c0cde25-a6bd-43f1-8d90-b170a21edd32","resolution":{"observed_at":"2026-05-22T13:34:52.950282Z","resolver_source":"doi","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-07T08:23:30.905688Z","title":null,"venue":null,"work_id":"1fff674f-0b8c-4105-a19f-1c11fc2da7e9","year":2020},"citing_paper":{"arxiv_id":"2505.17086","last_updated":"2026-04-14T00:27:30Z","snapshot_observed_at":"2026-08-14T10:49:19.013711Z","submitted_at":"2025-05-20T18:33:03Z","title":"Advancing Multi-Agent RAG Systems with Minimalist Reinforcement Learning","version":4},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-05-22T13:34:27.152447Z"},"links":{"citing_paper":"/paper/2505.17086"},"observation_digest":"sha256:b51b05e4a52ef1b12fd48b4aa4b542f9f2a3c705363c038cb55656f04b40463c","observation_id":"63ab7ec0-78e5-4435-aa0a-139cc13825e1","resolution":{"observed_at":"2026-05-22T13:34:53.883424Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-06T15:42:38.538343Z","title":null,"venue":null,"work_id":"b6977970-42fa-4df3-bebb-1864dda844b5","year":2020},"citing_paper":{"arxiv_id":"2505.17086","last_updated":"2026-04-14T00:27:30Z","snapshot_observed_at":"2026-08-14T10:49:19.013711Z","submitted_at":"2025-05-20T18:33:03Z","title":"Advancing Multi-Agent RAG Systems with Minimalist Reinforcement Learning","version":4},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-05-22T13:34:27.152447Z"},"links":{"citing_paper":"/paper/2505.17086"},"observation_digest":"sha256:c5ae7d47fc2e40f02ea1256b2067d1ff8580d818a53c5f0fe74ccab27b4922b3","observation_id":"94bd5507-b51f-40c8-bfa3-1aa2d2883d1b","resolution":{"observed_at":"2026-05-22T13:34:53.934439Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":null,"venue":null,"work_id":"db25a82a-8a39-497e-a4bc-454f31586713","year":null},"citing_paper":{"arxiv_id":"2505.17086","last_updated":"2026-04-14T00:27:30Z","snapshot_observed_at":"2026-08-14T10:49:19.013711Z","submitted_at":"2025-05-20T18:33:03Z","title":"Advancing Multi-Agent RAG Systems with Minimalist Reinforcement Learning","version":4},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-05-22T13:34:27.152447Z"},"links":{"citing_paper":"/paper/2505.17086"},"observation_digest":"sha256:a1ba2da4c281bafa8c4cdd300c11e5306c37d02b7e73de73402d06c7135e5373","observation_id":"32ee246e-7a91-4e48-9a6c-4f5b7863f9a9","resolution":{"observed_at":"2026-05-22T13:34:53.959262Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2410.18415","last_updated":"2024-10-24T04:01:40Z","snapshot_observed_at":"2026-08-16T13:06:25.266212Z","submitted_at":"2024-10-24T04:01:40Z","title":"Decoding on Graphs: Faithful and Sound Reasoning on Knowledge Graphs through Generation of Well-Formed Chains","version":1},"cited_work":{"arxiv_id":"2410.18415","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2410.18415","snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"arXiv:2410.18415 [cs.CL] https: //arxiv.org/abs/2410.18415","venue":null,"work_id":"a5715d89-083f-49d1-ac3a-488833d83b00","year":null},"citing_paper":{"arxiv_id":"2505.17086","last_updated":"2026-04-14T00:27:30Z","snapshot_observed_at":"2026-08-14T10:49:19.013711Z","submitted_at":"2025-05-20T18:33:03Z","title":"Advancing Multi-Agent RAG Systems with Minimalist Reinforcement Learning","version":4},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-05-22T13:34:27.152447Z"},"links":{"cited_paper":"/paper/2410.18415","citing_paper":"/paper/2505.17086"},"observation_digest":"sha256:7ec1ea9c9ddfd55911a6b951b0e373f6c00f1793647813f575c820d4ce0d08c2","observation_id":"f9d1e7b9-4d3c-4dbf-8099-c5d8bd1b7a5b","resolution":{"observed_at":"2026-05-22T13:34:53.186760Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":null,"venue":null,"work_id":"d479f6fa-8df7-4a75-a475-5ac47c49b62b","year":2025},"citing_paper":{"arxiv_id":"2505.17086","last_updated":"2026-04-14T00:27:30Z","snapshot_observed_at":"2026-08-14T10:49:19.013711Z","submitted_at":"2025-05-20T18:33:03Z","title":"Advancing Multi-Agent RAG Systems with Minimalist Reinforcement Learning","version":4},"reference_index":36,"source":"pdf_text","source_observed_at":"2026-05-22T13:34:27.152447Z"},"links":{"citing_paper":"/paper/2505.17086"},"observation_digest":"sha256:5ef894049d958ac33ef6a5a0d9a008ce2ce3264c0ca7af3aa996e3549b653cc2","observation_id":"84f4a756-54c4-4a23-a9da-163fee41d858","resolution":{"observed_at":"2026-05-22T13:34:53.892348Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":null,"venue":null,"work_id":"911e3420-9b37-4912-a028-e6b5ebb2bb58","year":2025},"citing_paper":{"arxiv_id":"2505.17086","last_updated":"2026-04-14T00:27:30Z","snapshot_observed_at":"2026-08-14T10:49:19.013711Z","submitted_at":"2025-05-20T18:33:03Z","title":"Advancing Multi-Agent RAG Systems with Minimalist Reinforcement Learning","version":4},"reference_index":37,"source":"pdf_text","source_observed_at":"2026-05-22T13:34:27.152447Z"},"links":{"citing_paper":"/paper/2505.17086"},"observation_digest":"sha256:726a10a25575e6a702aa765e992715997e9a86d4b74b732a881b0e4e482e7656","observation_id":"2f8961d4-2eac-4ad8-b027-c772dabfa430","resolution":{"observed_at":"2026-05-22T13:34:53.871756Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":"10.1609/aaai.v35i15.17568","metadata_source":"openalex","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":null,"venue":"Proceedings of the AAAI Conference on Artificial Intelligence","work_id":"96a240a5-ee58-48a6-99e4-04d788a5e773","year":2021},"citing_paper":{"arxiv_id":"2505.17086","last_updated":"2026-04-14T00:27:30Z","snapshot_observed_at":"2026-08-14T10:49:19.013711Z","submitted_at":"2025-05-20T18:33:03Z","title":"Advancing Multi-Agent RAG Systems with Minimalist Reinforcement Learning","version":4},"reference_index":38,"source":"pdf_text","source_observed_at":"2026-05-22T13:34:27.152447Z"},"links":{"citing_paper":"/paper/2505.17086"},"observation_digest":"sha256:894fc23c7025113bfea12e3f8bf404f9620d1c2948b90308d26590161c92b053","observation_id":"ed2f3971-c3dd-411d-9bca-3805c3132d21","resolution":{"observed_at":"2026-05-22T13:34:52.951715Z","resolver_source":"doi","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2501.05366","last_updated":"2025-01-09T16:48:17Z","snapshot_observed_at":"2026-08-15T17:19:59.096854Z","submitted_at":"2025-01-09T16:48:17Z","title":"Search-o1: Agentic Search-Enhanced Large Reasoning Models","version":1},"cited_work":{"arxiv_id":"2501.05366","doi":"10.48550/arxiv.2501.05366","metadata_source":"pith","pith_arxiv_id":"2501.05366","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Search-o1: Agentic Search-Enhanced Large Reasoning Models","venue":"cs.AI","work_id":"6246e99b-7b4e-4424-be78-3e1983932cdc","year":2025},"citing_paper":{"arxiv_id":"2505.17086","last_updated":"2026-04-14T00:27:30Z","snapshot_observed_at":"2026-08-14T10:49:19.013711Z","submitted_at":"2025-05-20T18:33:03Z","title":"Advancing Multi-Agent RAG Systems with Minimalist Reinforcement Learning","version":4},"reference_index":39,"source":"pdf_text","source_observed_at":"2026-05-22T13:34:27.152447Z"},"links":{"cited_paper":"/paper/2501.05366","citing_paper":"/paper/2505.17086"},"observation_digest":"sha256:096da3b8e97f8f26972dca9202c30a6d85db65450c19f4f933d31c91d5114079","observation_id":"ba2bde33-b128-4ab4-bf9a-f2d569215be6","resolution":{"observed_at":"2026-05-22T13:34:53.152893Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":null,"venue":null,"work_id":"16138a69-433c-4227-938a-d5ae47c01ef5","year":2024},"citing_paper":{"arxiv_id":"2505.17086","last_updated":"2026-04-14T00:27:30Z","snapshot_observed_at":"2026-08-14T10:49:19.013711Z","submitted_at":"2025-05-20T18:33:03Z","title":"Advancing Multi-Agent RAG Systems with Minimalist Reinforcement Learning","version":4},"reference_index":40,"source":"pdf_text","source_observed_at":"2026-05-22T13:34:27.152447Z"},"links":{"citing_paper":"/paper/2505.17086"},"observation_digest":"sha256:1828b5fae622cfe2013ef1da7d909783f0bb4e0d73402ebb57dbb80e13bdd8e6","observation_id":"a4bab77e-0261-4780-9279-fa56a389b30b","resolution":{"observed_at":"2026-05-22T13:34:53.874258Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":"10.1609/aaai.v39i23.34635","metadata_source":"openalex","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":null,"venue":"Proceedings of the AAAI Conference on Artificial Intelligence","work_id":"e7a80cba-0519-4e20-a2a7-add58690c9ca","year":2025},"citing_paper":{"arxiv_id":"2505.17086","last_updated":"2026-04-14T00:27:30Z","snapshot_observed_at":"2026-08-14T10:49:19.013711Z","submitted_at":"2025-05-20T18:33:03Z","title":"Advancing Multi-Agent RAG Systems with Minimalist Reinforcement Learning","version":4},"reference_index":41,"source":"pdf_text","source_observed_at":"2026-05-22T13:34:27.152447Z"},"links":{"citing_paper":"/paper/2505.17086"},"observation_digest":"sha256:f5e56aca5d06d11ba0cc94cac2cd9f1741b1664eda0d69772cfb0b44b09c2adf","observation_id":"65c6fac2-4c93-40fa-9e45-ba143fa31d35","resolution":{"observed_at":"2026-05-22T13:34:52.943968Z","resolver_source":"doi","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":"10.18653/v1/2023.findings-emnlp.423","metadata_source":"openalex","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":null,"venue":null,"work_id":"28883ac2-835e-4827-abe4-321036503aa8","year":2023},"citing_paper":{"arxiv_id":"2505.17086","last_updated":"2026-04-14T00:27:30Z","snapshot_observed_at":"2026-08-14T10:49:19.013711Z","submitted_at":"2025-05-20T18:33:03Z","title":"Advancing Multi-Agent RAG Systems with Minimalist Reinforcement Learning","version":4},"reference_index":42,"source":"pdf_text","source_observed_at":"2026-05-22T13:34:27.152447Z"},"links":{"citing_paper":"/paper/2505.17086"},"observation_digest":"sha256:86f2afbe3f5adc5d2561d760dab4eb51d6db5d5674c8b020fea61e2b0969f321","observation_id":"db850d96-cebf-45f6-9983-35760ceb37a5","resolution":{"observed_at":"2026-05-22T13:34:52.923580Z","resolver_source":"doi","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2504.01990","last_updated":"2025-08-02T12:44:02Z","snapshot_observed_at":"2026-08-12T16:45:40.094278Z","submitted_at":"2025-03-31T18:00:29Z","title":"Advances and Challenges in Foundation Agents: From Brain-Inspired Intelligence to Evolutionary, Collaborative, and Safe Systems","version":2},"cited_work":{"arxiv_id":"2504.01990","doi":"10.48550/arxiv.2504.01990","metadata_source":"pith","pith_arxiv_id":"2504.01990","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Advances and Challenges in Foundation Agents: From Brain-Inspired Intelligence to Evolutionary, Collaborative, and Safe Systems","venue":"cs.AI","work_id":"984dfe5e-1c5c-4b65-920e-15121a85ee7e","year":2025},"citing_paper":{"arxiv_id":"2505.17086","last_updated":"2026-04-14T00:27:30Z","snapshot_observed_at":"2026-08-14T10:49:19.013711Z","submitted_at":"2025-05-20T18:33:03Z","title":"Advancing Multi-Agent RAG Systems with Minimalist Reinforcement Learning","version":4},"reference_index":43,"source":"pdf_text","source_observed_at":"2026-05-22T13:34:27.152447Z"},"links":{"cited_paper":"/paper/2504.01990","citing_paper":"/paper/2505.17086"},"observation_digest":"sha256:c6911a379da3c705f1f64e4f7a10e12fa516def53249f8eca2a05e422cc8567d","observation_id":"f215d781-bf47-443b-9beb-a8b2cf9787a5","resolution":{"observed_at":"2026-05-22T13:34:53.078882Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":null,"venue":null,"work_id":"33b15393-ed37-4adb-a8ba-c6d0581531ab","year":2024},"citing_paper":{"arxiv_id":"2505.17086","last_updated":"2026-04-14T00:27:30Z","snapshot_observed_at":"2026-08-14T10:49:19.013711Z","submitted_at":"2025-05-20T18:33:03Z","title":"Advancing Multi-Agent RAG Systems with Minimalist Reinforcement Learning","version":4},"reference_index":44,"source":"pdf_text","source_observed_at":"2026-05-22T13:34:27.152447Z"},"links":{"citing_paper":"/paper/2505.17086"},"observation_digest":"sha256:c89b5ae22f227e07d691674adb0b61998feff4ee008d4a6a26cecc4625cabccf","observation_id":"aa683c86-7f77-46fd-9dab-9d4d4be53d32","resolution":{"observed_at":"2026-05-22T13:34:53.861305Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2403.08632","last_updated":"2025-03-03T12:01:27Z","snapshot_observed_at":"2026-08-16T14:10:08.798819Z","submitted_at":"2024-03-13T15:46:37Z","title":"A Decade's Battle on Dataset Bias: Are We There Yet?","version":2},"cited_work":{"arxiv_id":"2403.08632","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2403.08632","snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"arXiv preprint arXiv:2403.08632 , year=","venue":null,"work_id":"a8e96247-87c1-4bc7-a196-38271d643182","year":2024},"citing_paper":{"arxiv_id":"2505.17086","last_updated":"2026-04-14T00:27:30Z","snapshot_observed_at":"2026-08-14T10:49:19.013711Z","submitted_at":"2025-05-20T18:33:03Z","title":"Advancing Multi-Agent RAG Systems with Minimalist Reinforcement Learning","version":4},"reference_index":45,"source":"pdf_text","source_observed_at":"2026-05-22T13:34:27.152447Z"},"links":{"cited_paper":"/paper/2403.08632","citing_paper":"/paper/2505.17086"},"observation_digest":"sha256:ffafcb43d3058f1f4cbc9b7738a3f45558288b6ab587f288c26105b0544b383e","observation_id":"75832a51-976c-45a1-ae3d-dddaa45c694a","resolution":{"observed_at":"2026-05-22T13:34:53.116274Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":null,"venue":null,"work_id":"72848dc6-0eca-4d37-a7b2-66a1a660f5cb","year":2017},"citing_paper":{"arxiv_id":"2505.17086","last_updated":"2026-04-14T00:27:30Z","snapshot_observed_at":"2026-08-14T10:49:19.013711Z","submitted_at":"2025-05-20T18:33:03Z","title":"Advancing Multi-Agent RAG Systems with Minimalist Reinforcement Learning","version":4},"reference_index":46,"source":"pdf_text","source_observed_at":"2026-05-22T13:34:27.152447Z"},"links":{"citing_paper":"/paper/2505.17086"},"observation_digest":"sha256:ddf502251465cbf19d369b5639f9254f6e4ddef3c6c28b323211288255e8dd8e","observation_id":"6670b300-d590-483f-9b0c-cabfa0b639a6","resolution":{"observed_at":"2026-05-22T13:34:53.905073Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-09T13:26:17.019108Z","title":null,"venue":null,"work_id":"7fcb55d6-6bb2-456a-b13b-ed7ae9868cae","year":2019},"citing_paper":{"arxiv_id":"2505.17086","last_updated":"2026-04-14T00:27:30Z","snapshot_observed_at":"2026-08-14T10:49:19.013711Z","submitted_at":"2025-05-20T18:33:03Z","title":"Advancing Multi-Agent RAG Systems with Minimalist Reinforcement Learning","version":4},"reference_index":47,"source":"pdf_text","source_observed_at":"2026-05-22T13:34:27.152447Z"},"links":{"citing_paper":"/paper/2505.17086"},"observation_digest":"sha256:06442b6c0a8ec597602adf39d6520a4171938e7cac80483cfdec73f39b700fc7","observation_id":"028e2ac9-6b93-4be6-ade5-d8df259bef38","resolution":{"observed_at":"2026-05-22T13:34:53.843196Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":null,"venue":null,"work_id":"5c5470c3-235d-4620-b778-91d090bbd036","year":2024},"citing_paper":{"arxiv_id":"2505.17086","last_updated":"2026-04-14T00:27:30Z","snapshot_observed_at":"2026-08-14T10:49:19.013711Z","submitted_at":"2025-05-20T18:33:03Z","title":"Advancing Multi-Agent RAG Systems with Minimalist Reinforcement Learning","version":4},"reference_index":48,"source":"pdf_text","source_observed_at":"2026-05-22T13:34:27.152447Z"},"links":{"citing_paper":"/paper/2505.17086"},"observation_digest":"sha256:1c660ca4f081cc5c00c7037edcfb5c4e23353ea782b3f45962d5503c07af762c","observation_id":"82b37ab0-2107-4ce3-b784-45d35f9df4c8","resolution":{"observed_at":"2026-05-22T13:34:53.994028Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":null,"venue":null,"work_id":"7a5f4fdd-f3f7-4341-abbf-edeaa5200e16","year":null},"citing_paper":{"arxiv_id":"2505.17086","last_updated":"2026-04-14T00:27:30Z","snapshot_observed_at":"2026-08-14T10:49:19.013711Z","submitted_at":"2025-05-20T18:33:03Z","title":"Advancing Multi-Agent RAG Systems with Minimalist Reinforcement Learning","version":4},"reference_index":49,"source":"pdf_text","source_observed_at":"2026-05-22T13:34:27.152447Z"},"links":{"citing_paper":"/paper/2505.17086"},"observation_digest":"sha256:076b4cf58506fab4f0e261a51a8e479741c4c3127bca875424a7f27e714a0daf","observation_id":"e15f87c5-ac98-4923-89c5-6e2026ed3cf8","resolution":{"observed_at":"2026-05-22T13:34:53.996138Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"https://openreview.net/forum?id=6embY8aclt","venue":null,"work_id":"808e2e53-3462-4e50-9073-bc8726faf2eb","year":null},"citing_paper":{"arxiv_id":"2505.17086","last_updated":"2026-04-14T00:27:30Z","snapshot_observed_at":"2026-08-14T10:49:19.013711Z","submitted_at":"2025-05-20T18:33:03Z","title":"Advancing Multi-Agent RAG Systems with Minimalist Reinforcement Learning","version":4},"reference_index":50,"source":"pdf_text","source_observed_at":"2026-05-22T13:34:27.152447Z"},"links":{"citing_paper":"/paper/2505.17086"},"observation_digest":"sha256:9f55054f6f44a8df925ce7f73d8c8f7087c298a3b292fd8ac8963e9b6aca70a2","observation_id":"30ca05af-b088-427e-b211-140b24cec8a0","resolution":{"observed_at":"2026-05-22T13:34:53.846063Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":null,"venue":null,"work_id":"67d12017-c136-4dc4-b6b8-f7b970754806","year":2025},"citing_paper":{"arxiv_id":"2505.17086","last_updated":"2026-04-14T00:27:30Z","snapshot_observed_at":"2026-08-14T10:49:19.013711Z","submitted_at":"2025-05-20T18:33:03Z","title":"Advancing Multi-Agent RAG Systems with Minimalist Reinforcement Learning","version":4},"reference_index":51,"source":"pdf_text","source_observed_at":"2026-05-22T13:34:27.152447Z"},"links":{"citing_paper":"/paper/2505.17086"},"observation_digest":"sha256:7530adfcffa05ab72e6adb4e83b003956ef12cbce10c1a1f142b97f002279d2b","observation_id":"46ef7f3b-93e4-4fd1-87e0-234576b26c6d","resolution":{"observed_at":"2026-05-22T13:34:53.855670Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":"10.18653/v1/2024.findings-emnlp.49","metadata_source":"openalex","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":null,"venue":null,"work_id":"797b4587-ddd2-4c3b-918b-b20cacb5681d","year":2024},"citing_paper":{"arxiv_id":"2505.17086","last_updated":"2026-04-14T00:27:30Z","snapshot_observed_at":"2026-08-14T10:49:19.013711Z","submitted_at":"2025-05-20T18:33:03Z","title":"Advancing Multi-Agent RAG Systems with Minimalist Reinforcement Learning","version":4},"reference_index":52,"source":"pdf_text","source_observed_at":"2026-05-22T13:34:27.152447Z"},"links":{"citing_paper":"/paper/2505.17086"},"observation_digest":"sha256:d3000d383714fbac3561d3fd5e618195db670891eb2dd40923a80b256d8e5a71","observation_id":"c9369a94-b6f2-4b77-b73b-37ea4795e6f7","resolution":{"observed_at":"2026-05-22T13:34:52.937035Z","resolver_source":"doi","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":null,"venue":null,"work_id":"8eaca4c5-1db0-471c-b62b-1fdb22d86716","year":2024},"citing_paper":{"arxiv_id":"2505.17086","last_updated":"2026-04-14T00:27:30Z","snapshot_observed_at":"2026-08-14T10:49:19.013711Z","submitted_at":"2025-05-20T18:33:03Z","title":"Advancing Multi-Agent RAG Systems with Minimalist Reinforcement Learning","version":4},"reference_index":53,"source":"pdf_text","source_observed_at":"2026-05-22T13:34:27.152447Z"},"links":{"citing_paper":"/paper/2505.17086"},"observation_digest":"sha256:31b4bd2f393dd7dc9f331e2949ce7f3133838eda25df7fe614583bfa8825088d","observation_id":"ff7254b5-0989-46cc-936d-ab263c124ad5","resolution":{"observed_at":"2026-05-22T13:34:53.843682Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2405.20139","last_updated":"2024-05-30T15:14:24Z","snapshot_observed_at":"2026-08-16T13:47:42.665701Z","submitted_at":"2024-05-30T15:14:24Z","title":"GNN-RAG: Graph Neural Retrieval for Large Language Model Reasoning","version":1},"cited_work":{"arxiv_id":"2405.20139","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2405.20139","snapshot_observed_at":"2026-07-02T18:47:17.231591Z","title":"and Karypis, G","venue":null,"work_id":"7fbe1a28-6a3b-4e93-a813-7ac7a59e6ae1","year":2024},"citing_paper":{"arxiv_id":"2505.17086","last_updated":"2026-04-14T00:27:30Z","snapshot_observed_at":"2026-08-14T10:49:19.013711Z","submitted_at":"2025-05-20T18:33:03Z","title":"Advancing Multi-Agent RAG Systems with Minimalist Reinforcement Learning","version":4},"reference_index":54,"source":"pdf_text","source_observed_at":"2026-05-22T13:34:27.152447Z"},"links":{"cited_paper":"/paper/2405.20139","citing_paper":"/paper/2505.17086"},"observation_digest":"sha256:794d048a3d46c1ddff07bc4731f7d3df830a73bff3986f0c6ac89c874f0cc7e8","observation_id":"69df683a-c45e-4a71-a3a2-bb69d6605ed1","resolution":{"observed_at":"2026-05-22T13:34:53.142856Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-09T11:26:12.372824Z","title":null,"venue":null,"work_id":"b2b8e4c9-2223-47d1-b0bb-83573eb2e28b","year":2022},"citing_paper":{"arxiv_id":"2505.17086","last_updated":"2026-04-14T00:27:30Z","snapshot_observed_at":"2026-08-14T10:49:19.013711Z","submitted_at":"2025-05-20T18:33:03Z","title":"Advancing Multi-Agent RAG Systems with Minimalist Reinforcement Learning","version":4},"reference_index":55,"source":"pdf_text","source_observed_at":"2026-05-22T13:34:27.152447Z"},"links":{"citing_paper":"/paper/2505.17086"},"observation_digest":"sha256:8f8b5a686256081f4f79b474d99748de0b7ab487c7d24a64b6de44d5ca2775f5","observation_id":"14250196-9e63-422f-a59a-6d6c32e24ec9","resolution":{"observed_at":"2026-05-22T13:34:53.840951Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"5064.2022","doi":"10.1109/ijcnn55064.2022","metadata_source":"arxiv_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Liang, Y.-C","venue":null,"work_id":"78495e4b-a848-4bb6-8bb4-3a59e4e275f9","year":2022},"citing_paper":{"arxiv_id":"2505.17086","last_updated":"2026-04-14T00:27:30Z","snapshot_observed_at":"2026-08-14T10:49:19.013711Z","submitted_at":"2025-05-20T18:33:03Z","title":"Advancing Multi-Agent RAG Systems with Minimalist Reinforcement Learning","version":4},"reference_index":56,"source":"pdf_text","source_observed_at":"2026-05-22T13:34:27.152447Z"},"links":{"citing_paper":"/paper/2505.17086"},"observation_digest":"sha256:24551dcf89699a3b8f03c61dff5e68ecc07cf5057df607a5a734d60bc51449a6","observation_id":"81cfd157-a3ca-4b9d-8f9a-01bfec9f6305","resolution":{"observed_at":"2026-05-22T13:34:52.903307Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":null,"venue":null,"work_id":"9c4e2f7e-eb62-4a5b-9df5-a953d50dba71","year":null},"citing_paper":{"arxiv_id":"2505.17086","last_updated":"2026-04-14T00:27:30Z","snapshot_observed_at":"2026-08-14T10:49:19.013711Z","submitted_at":"2025-05-20T18:33:03Z","title":"Advancing Multi-Agent RAG Systems with Minimalist Reinforcement Learning","version":4},"reference_index":57,"source":"pdf_text","source_observed_at":"2026-05-22T13:34:27.152447Z"},"links":{"citing_paper":"/paper/2505.17086"},"observation_digest":"sha256:2e61c1715dd603d66f90c25451df087ad3c04881c7b40e0d83df20f803e3018b","observation_id":"b8620f26-cf82-4662-bc82-f76be9a04c4e","resolution":{"observed_at":"2026-05-22T13:34:53.840325Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":null,"venue":null,"work_id":"a2528368-8a67-44ab-a46a-f1bc8f2c0891","year":2023},"citing_paper":{"arxiv_id":"2505.17086","last_updated":"2026-04-14T00:27:30Z","snapshot_observed_at":"2026-08-14T10:49:19.013711Z","submitted_at":"2025-05-20T18:33:03Z","title":"Advancing Multi-Agent RAG Systems with Minimalist Reinforcement Learning","version":4},"reference_index":58,"source":"pdf_text","source_observed_at":"2026-05-22T13:34:27.152447Z"},"links":{"citing_paper":"/paper/2505.17086"},"observation_digest":"sha256:4c122851a8708ddef3425caeb9cbb9efe712fa76a726a6111ddd837710c35516","observation_id":"e0d20a82-8765-4136-831f-f8377869dd0a","resolution":{"observed_at":"2026-05-22T13:34:53.852460Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":"10.1561/1500000019","metadata_source":"doi_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-08T19:25:32.314017Z","title":"Robertson and Hugo Zaragoza , title =","venue":"Foundations and Trends® in Information Retrieval","work_id":"3dfaa21d-3751-420b-84f7-aeceda058b63","year":2009},"citing_paper":{"arxiv_id":"2505.17086","last_updated":"2026-04-14T00:27:30Z","snapshot_observed_at":"2026-08-14T10:49:19.013711Z","submitted_at":"2025-05-20T18:33:03Z","title":"Advancing Multi-Agent RAG Systems with Minimalist Reinforcement Learning","version":4},"reference_index":59,"source":"pdf_text","source_observed_at":"2026-05-22T13:34:27.152447Z"},"links":{"citing_paper":"/paper/2505.17086"},"observation_digest":"sha256:2f177ef5b6a94cfc82f84fb97b079b6acddad2ae6f2abfb44540e3219fe935ed","observation_id":"5eb9df8d-c109-41d5-9be3-7aa126110235","resolution":{"observed_at":"2026-05-22T13:34:52.931638Z","resolver_source":"doi","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-13T18:38:55.295493+00:00","source":"crossref_status_cache"},{"observed_at":"2026-08-13T18:38:55.295493+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":null,"venue":null,"work_id":"8032a314-4311-4980-95b7-6e1ea6b1891d","year":null},"citing_paper":{"arxiv_id":"2505.17086","last_updated":"2026-04-14T00:27:30Z","snapshot_observed_at":"2026-08-14T10:49:19.013711Z","submitted_at":"2025-05-20T18:33:03Z","title":"Advancing Multi-Agent RAG Systems with Minimalist Reinforcement Learning","version":4},"reference_index":60,"source":"pdf_text","source_observed_at":"2026-05-22T13:34:27.152447Z"},"links":{"citing_paper":"/paper/2505.17086"},"observation_digest":"sha256:7eb29d9f8843f99d6b7321c2e541509e2d058f2df133e0fb142f0b8d69ba59ef","observation_id":"e2ee5bfa-4dfa-4cf6-8980-92c1b92c6d78","resolution":{"observed_at":"2026-05-22T13:34:53.941039Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"InInternational conference on machine learning","venue":null,"work_id":"f9e561d2-a95e-45d8-b19b-0bd714f07ba8","year":null},"citing_paper":{"arxiv_id":"2505.17086","last_updated":"2026-04-14T00:27:30Z","snapshot_observed_at":"2026-08-14T10:49:19.013711Z","submitted_at":"2025-05-20T18:33:03Z","title":"Advancing Multi-Agent RAG Systems with Minimalist Reinforcement Learning","version":4},"reference_index":61,"source":"pdf_text","source_observed_at":"2026-05-22T13:34:27.152447Z"},"links":{"citing_paper":"/paper/2505.17086"},"observation_digest":"sha256:4f1dec699b77ea8c4a176c38b7562425806f7e7e726b6a4e0b2cd81a69fac5c0","observation_id":"228b8b47-96c9-436f-860e-615fc6d554b9","resolution":{"observed_at":"2026-05-22T13:34:53.867969Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1506.02438","last_updated":"2018-10-20T18:55:07Z","snapshot_observed_at":"2026-08-15T05:06:05.489107Z","submitted_at":"2015-06-08T11:12:48Z","title":"High-Dimensional Continuous Control Using Generalized Advantage Estimation","version":6},"cited_work":{"arxiv_id":"1506.02438","doi":"10.48550/arxiv.1506.02438","metadata_source":"pith","pith_arxiv_id":"1506.02438","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"High-Dimensional Continuous Control Using Generalized Advantage Estimation","venue":"cs.LG","work_id":"38e3ca94-96f0-4b19-a355-0754931af8be","year":2015},"citing_paper":{"arxiv_id":"2505.17086","last_updated":"2026-04-14T00:27:30Z","snapshot_observed_at":"2026-08-14T10:49:19.013711Z","submitted_at":"2025-05-20T18:33:03Z","title":"Advancing Multi-Agent RAG Systems with Minimalist Reinforcement Learning","version":4},"reference_index":62,"source":"pdf_text","source_observed_at":"2026-05-22T13:34:27.152447Z"},"links":{"cited_paper":"/paper/1506.02438","citing_paper":"/paper/2505.17086"},"observation_digest":"sha256:d6823b6b5a883f32f32a8176b791a47f57dface3cdf9b13c06ca52bda5b8606e","observation_id":"12167cee-1ac8-482f-811a-d6d5e41c3157","resolution":{"observed_at":"2026-05-22T13:34:53.181982Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-10T03:26:44.692677Z","title":null,"venue":null,"work_id":"d5783126-8b9e-46a0-be2a-7b4ccf458ca9","year":null},"citing_paper":{"arxiv_id":"2505.17086","last_updated":"2026-04-14T00:27:30Z","snapshot_observed_at":"2026-08-14T10:49:19.013711Z","submitted_at":"2025-05-20T18:33:03Z","title":"Advancing Multi-Agent RAG Systems with Minimalist Reinforcement Learning","version":4},"reference_index":63,"source":"pdf_text","source_observed_at":"2026-05-22T13:34:27.152447Z"},"links":{"citing_paper":"/paper/2505.17086"},"observation_digest":"sha256:179b23247b8ce18d175ad997b3cd3b42292a38bc6f0db305fcae82965b735283","observation_id":"797c5836-3941-4e07-a42f-de4606297130","resolution":{"observed_at":"2026-05-22T13:34:53.938468Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1707.06347","last_updated":"2017-08-28T09:20:06Z","snapshot_observed_at":"2026-08-15T20:26:32.102285Z","submitted_at":"2017-07-20T02:32:33Z","title":"Proximal Policy Optimization Algorithms","version":2},"cited_work":{"arxiv_id":"1707.06347","doi":"10.1016/j.artint.2010.12.005","metadata_source":"pith","pith_arxiv_id":"1707.06347","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Proximal Policy Optimization Algorithms","venue":"cs.LG","work_id":"240c67fe-d14d-4520-91c1-38a4e272ca19","year":2017},"citing_paper":{"arxiv_id":"2505.17086","last_updated":"2026-04-14T00:27:30Z","snapshot_observed_at":"2026-08-14T10:49:19.013711Z","submitted_at":"2025-05-20T18:33:03Z","title":"Advancing Multi-Agent RAG Systems with Minimalist Reinforcement Learning","version":4},"reference_index":64,"source":"pdf_text","source_observed_at":"2026-05-22T13:34:27.152447Z"},"links":{"cited_paper":"/paper/1707.06347","citing_paper":"/paper/2505.17086"},"observation_digest":"sha256:90b3283afa5fdf357f6ffc7909a1cb49bdb3e06819a7f9903ab45c9b4ba2ec95","observation_id":"2706d255-9682-4cc4-ba20-b831588acbf5","resolution":{"observed_at":"2026-05-22T13:34:53.179900Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":null,"venue":null,"work_id":"aff3621e-7eee-49d9-9e64-1d6821856d19","year":2023},"citing_paper":{"arxiv_id":"2505.17086","last_updated":"2026-04-14T00:27:30Z","snapshot_observed_at":"2026-08-14T10:49:19.013711Z","submitted_at":"2025-05-20T18:33:03Z","title":"Advancing Multi-Agent RAG Systems with Minimalist Reinforcement Learning","version":4},"reference_index":65,"source":"pdf_text","source_observed_at":"2026-05-22T13:34:27.152447Z"},"links":{"citing_paper":"/paper/2505.17086"},"observation_digest":"sha256:4cd61bfa42264fe661684a62e31b6d70d94c6739162b1d8d8df15d6d547a5878","observation_id":"2d4a8903-2457-42b3-8a14-0e123a2c1a51","resolution":{"observed_at":"2026-05-22T13:34:53.880175Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":"10.18653/v1/2023.findings-emnlp.620","metadata_source":"openalex","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Enhancing retrieval-augmented large language models with iterative retrieval-generation synergy","venue":null,"work_id":"2c5a8029-763e-4158-bc9f-488bb052d946","year":2023},"citing_paper":{"arxiv_id":"2505.17086","last_updated":"2026-04-14T00:27:30Z","snapshot_observed_at":"2026-08-14T10:49:19.013711Z","submitted_at":"2025-05-20T18:33:03Z","title":"Advancing Multi-Agent RAG Systems with Minimalist Reinforcement Learning","version":4},"reference_index":66,"source":"pdf_text","source_observed_at":"2026-05-22T13:34:27.152447Z"},"links":{"citing_paper":"/paper/2505.17086"},"observation_digest":"sha256:c4624795ab963eaf1da4393e44ac1249462cf5dc403839937e5c6fa40318eef3","observation_id":"2bac2fb5-2872-48f9-9b5a-7fc6c15102d9","resolution":{"observed_at":"2026-05-22T13:34:52.955461Z","resolver_source":"doi","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-10T15:38:29.165306+00:00","source":"crossref_status_cache"},{"observed_at":"2026-08-10T15:38:29.165306+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2402.03300","last_updated":"2024-04-27T15:25:53Z","snapshot_observed_at":"2026-08-06T14:58:42.911363Z","submitted_at":"2024-02-05T18:55:32Z","title":"DeepSeekMath: Pushing the Limits of Mathematical Reasoning in Open Language Models","version":3},"cited_work":{"arxiv_id":"2402.03300","doi":"10.1016/0004-3702(73)90011-8","metadata_source":"pith","pith_arxiv_id":"2402.03300","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"DeepSeekMath: Pushing the Limits of Mathematical Reasoning in Open Language Models","venue":"cs.CL","work_id":"c5006563-f3ec-438a-9e35-b7b484f34828","year":2024},"citing_paper":{"arxiv_id":"2505.17086","last_updated":"2026-04-14T00:27:30Z","snapshot_observed_at":"2026-08-14T10:49:19.013711Z","submitted_at":"2025-05-20T18:33:03Z","title":"Advancing Multi-Agent RAG Systems with Minimalist Reinforcement Learning","version":4},"reference_index":67,"source":"pdf_text","source_observed_at":"2026-05-22T13:34:27.152447Z"},"links":{"cited_paper":"/paper/2402.03300","citing_paper":"/paper/2505.17086"},"observation_digest":"sha256:cb7adf0109d0483fceda660a25ee6c29c02b3df2613e7e7a50c568d2387a2859","observation_id":"7c20d264-2b2b-4b7e-b31e-3fac4fc8d913","resolution":{"observed_at":"2026-05-22T13:34:53.121735Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":"10.18653/v1/2022","metadata_source":"doi_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-04T17:29:59.328028Z","title":"37 Wenyue Hua, Lizhou Fan, Lingyao Li, Kai Mei, Jianchao Ji, Yingqiang Ge, Libby Hemphill, and Yongfeng Zhang","venue":null,"work_id":"ed940a1a-3e19-4658-88d1-34194ac465ee","year":2022},"citing_paper":{"arxiv_id":"2505.17086","last_updated":"2026-04-14T00:27:30Z","snapshot_observed_at":"2026-08-14T10:49:19.013711Z","submitted_at":"2025-05-20T18:33:03Z","title":"Advancing Multi-Agent RAG Systems with Minimalist Reinforcement Learning","version":4},"reference_index":68,"source":"pdf_text","source_observed_at":"2026-05-22T13:34:27.152447Z"},"links":{"citing_paper":"/paper/2505.17086"},"observation_digest":"sha256:98ccc7c54d8031874e667c7880fca6b180520e2d656e87c49691d08fed2826f6","observation_id":"ca894031-08bc-42f6-8360-3416e12ea9eb","resolution":{"observed_at":"2026-05-22T13:34:52.942199Z","resolver_source":"doi","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-10T19:08:13.136461+00:00","source":"crossref_status_cache"},{"observed_at":"2026-08-10T19:08:13.136461+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2503.05592","last_updated":"2025-03-18T08:32:24Z","snapshot_observed_at":"2026-08-15T04:19:26.319323Z","submitted_at":"2025-03-07T17:14:44Z","title":"R1-Searcher: Incentivizing the Search Capability in LLMs via Reinforcement Learning","version":2},"cited_work":{"arxiv_id":"2503.05592","doi":"10.48550/arxiv.2503.05592","metadata_source":"pith","pith_arxiv_id":"2503.05592","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"R1-Searcher: Incentivizing the Search Capability in LLMs via Reinforcement Learning","venue":"cs.AI","work_id":"f5ed73d2-f2ff-4cf6-853d-3586333e44ef","year":2025},"citing_paper":{"arxiv_id":"2505.17086","last_updated":"2026-04-14T00:27:30Z","snapshot_observed_at":"2026-08-14T10:49:19.013711Z","submitted_at":"2025-05-20T18:33:03Z","title":"Advancing Multi-Agent RAG Systems with Minimalist Reinforcement Learning","version":4},"reference_index":69,"source":"pdf_text","source_observed_at":"2026-05-22T13:34:27.152447Z"},"links":{"cited_paper":"/paper/2503.05592","citing_paper":"/paper/2505.17086"},"observation_digest":"sha256:72aa22fa88a28f65e83def723d158a9426da34e2958bb9d3aafb1313f6eded60","observation_id":"fd15051a-ee70-40cf-b320-c3c937fe93b6","resolution":{"observed_at":"2026-05-22T13:34:53.126608Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2405.13873","last_updated":"2025-05-22T08:07:01Z","snapshot_observed_at":"2026-08-16T13:50:31.502466Z","submitted_at":"2024-05-22T17:56:53Z","title":"FiDeLiS: Faithful Reasoning in Large Language Model for Knowledge Graph Question Answering","version":4},"cited_work":{"arxiv_id":"2405.13873","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2405.13873","snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":null,"venue":null,"work_id":"d6da62e2-ca57-423f-bb86-cf057c1ce634","year":2025},"citing_paper":{"arxiv_id":"2505.17086","last_updated":"2026-04-14T00:27:30Z","snapshot_observed_at":"2026-08-14T10:49:19.013711Z","submitted_at":"2025-05-20T18:33:03Z","title":"Advancing Multi-Agent RAG Systems with Minimalist Reinforcement Learning","version":4},"reference_index":70,"source":"pdf_text","source_observed_at":"2026-05-22T13:34:27.152447Z"},"links":{"cited_paper":"/paper/2405.13873","citing_paper":"/paper/2505.17086"},"observation_digest":"sha256:0d65410ceeabf766b6f99afc5fa9604951c14515ab4192a2b3d223b2602824d4","observation_id":"889a08a8-7a6e-4973-ba6a-b0f9fe017e5a","resolution":{"observed_at":"2026-05-22T13:34:53.175061Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2505.04588","last_updated":"2026-05-19T11:51:42Z","snapshot_observed_at":"2026-08-04T18:36:41.979541Z","submitted_at":"2025-05-07T17:30:22Z","title":"ZeroSearch: Incentivize the Search Capability of LLMs without Searching","version":3},"cited_work":{"arxiv_id":"2505.04588","doi":"10.48550/arxiv.2505.04588","metadata_source":"pith","pith_arxiv_id":"2505.04588","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"ZeroSearch: Incentivize the Search Capability of LLMs without Searching","venue":"cs.CL","work_id":"0ea11521-4603-4e7a-abe3-bbc2f3e3f71c","year":2025},"citing_paper":{"arxiv_id":"2505.17086","last_updated":"2026-04-14T00:27:30Z","snapshot_observed_at":"2026-08-14T10:49:19.013711Z","submitted_at":"2025-05-20T18:33:03Z","title":"Advancing Multi-Agent RAG Systems with Minimalist Reinforcement Learning","version":4},"reference_index":71,"source":"pdf_text","source_observed_at":"2026-05-22T13:34:27.152447Z"},"links":{"cited_paper":"/paper/2505.04588","citing_paper":"/paper/2505.17086"},"observation_digest":"sha256:f6cb4b90849aa8f505791862a523f12ffc158ae9b3dd9a34f685b4969e6cfaae","observation_id":"79501cbb-1579-41cb-a840-1559fde82470","resolution":{"observed_at":"2026-05-22T13:34:53.194692Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":null,"venue":null,"work_id":"a529f639-5a27-4634-b4a0-408f242f89c7","year":2024},"citing_paper":{"arxiv_id":"2505.17086","last_updated":"2026-04-14T00:27:30Z","snapshot_observed_at":"2026-08-14T10:49:19.013711Z","submitted_at":"2025-05-20T18:33:03Z","title":"Advancing Multi-Agent RAG Systems with Minimalist Reinforcement Learning","version":4},"reference_index":72,"source":"pdf_text","source_observed_at":"2026-05-22T13:34:27.152447Z"},"links":{"citing_paper":"/paper/2505.17086"},"observation_digest":"sha256:ca1c68f51501f8e411a6646389b52c2678d3b1400e9df7e860d8b8bc1499147c","observation_id":"71256b7f-e2f4-4600-b20d-a03f10b55eab","resolution":{"observed_at":"2026-05-22T13:34:53.816985Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":null,"venue":null,"work_id":"6e5d7f6d-09ae-4eb5-956e-b04e680373e3","year":null},"citing_paper":{"arxiv_id":"2505.17086","last_updated":"2026-04-14T00:27:30Z","snapshot_observed_at":"2026-08-14T10:49:19.013711Z","submitted_at":"2025-05-20T18:33:03Z","title":"Advancing Multi-Agent RAG Systems with Minimalist Reinforcement Learning","version":4},"reference_index":73,"source":"pdf_text","source_observed_at":"2026-05-22T13:34:27.152447Z"},"links":{"citing_paper":"/paper/2505.17086"},"observation_digest":"sha256:ff78c46568de964effb5b2648154673d6d49e8c2f97eadbd2c7f9e83be605804","observation_id":"b0e5bb44-0db6-4927-bedc-d5343411dff7","resolution":{"observed_at":"2026-05-22T13:34:53.870897Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2410.14211","last_updated":"2025-03-12T23:45:13Z","snapshot_observed_at":"2026-08-19T07:33:23.691825Z","submitted_at":"2024-10-18T06:57:19Z","title":"Paths-over-Graph: Knowledge Graph Empowered Large Language Model Reasoning","version":4},"cited_work":{"arxiv_id":"2410.14211","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2410.14211","snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"arXiv:2410.14211 [cs.CL] https://arxiv.org/abs/2410.14211","venue":null,"work_id":"d64ba2a8-869d-4d6e-99c2-7028343407c7","year":null},"citing_paper":{"arxiv_id":"2505.17086","last_updated":"2026-04-14T00:27:30Z","snapshot_observed_at":"2026-08-14T10:49:19.013711Z","submitted_at":"2025-05-20T18:33:03Z","title":"Advancing Multi-Agent RAG Systems with Minimalist Reinforcement Learning","version":4},"reference_index":74,"source":"pdf_text","source_observed_at":"2026-05-22T13:34:27.152447Z"},"links":{"cited_paper":"/paper/2410.14211","citing_paper":"/paper/2505.17086"},"observation_digest":"sha256:ffeab2ecba67ca284986279bbe6b9a6be6d0587e0b04eeeba79989911189e5de","observation_id":"964319b7-0fdb-42e6-b593-2559a1415f93","resolution":{"observed_at":"2026-05-22T13:34:53.201008Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2405.08448","last_updated":"2024-05-14T09:12:30Z","snapshot_observed_at":"2026-08-16T13:52:52.945242Z","submitted_at":"2024-05-14T09:12:30Z","title":"Understanding the performance gap between online and offline alignment algorithms","version":1},"cited_work":{"arxiv_id":"2405.08448","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2405.08448","snapshot_observed_at":"2026-07-02T03:46:33.108981Z","title":"Understanding the performance gap between online and offline alignment algorithms","venue":null,"work_id":"92c35cdc-3e32-404d-a038-8a1f4228a044","year":2024},"citing_paper":{"arxiv_id":"2505.17086","last_updated":"2026-04-14T00:27:30Z","snapshot_observed_at":"2026-08-14T10:49:19.013711Z","submitted_at":"2025-05-20T18:33:03Z","title":"Advancing Multi-Agent RAG Systems with Minimalist Reinforcement Learning","version":4},"reference_index":75,"source":"pdf_text","source_observed_at":"2026-05-22T13:34:27.152447Z"},"links":{"cited_paper":"/paper/2405.08448","citing_paper":"/paper/2505.17086"},"observation_digest":"sha256:17f28adca4bef8e08b0c8324909f0e50dbba9cd82398c8e77a200c4100dddddd","observation_id":"34518477-89fe-4da5-abbc-e97a0e2281e9","resolution":{"observed_at":"2026-05-22T13:34:53.134007Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Transactions of the Association for Computational Linguistics(2022)","venue":null,"work_id":"173836e1-1210-4938-82be-c919dedce7a6","year":2022},"citing_paper":{"arxiv_id":"2505.17086","last_updated":"2026-04-14T00:27:30Z","snapshot_observed_at":"2026-08-14T10:49:19.013711Z","submitted_at":"2025-05-20T18:33:03Z","title":"Advancing Multi-Agent RAG Systems with Minimalist Reinforcement Learning","version":4},"reference_index":77,"source":"pdf_text","source_observed_at":"2026-05-22T13:34:27.152447Z"},"links":{"citing_paper":"/paper/2505.17086"},"observation_digest":"sha256:df4329d880297707592220e1e6431a0d0f7ac99cbf96cda841e6921b8f7a6477","observation_id":"33f444d3-985b-4343-b106-162249ed29ba","resolution":{"observed_at":"2026-05-22T13:34:53.860458Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-07T08:23:30.926135Z","title":null,"venue":null,"work_id":"c261ea03-7667-4f54-9096-31a177264728","year":null},"citing_paper":{"arxiv_id":"2505.17086","last_updated":"2026-04-14T00:27:30Z","snapshot_observed_at":"2026-08-14T10:49:19.013711Z","submitted_at":"2025-05-20T18:33:03Z","title":"Advancing Multi-Agent RAG Systems with Minimalist Reinforcement Learning","version":4},"reference_index":78,"source":"pdf_text","source_observed_at":"2026-05-22T13:34:27.152447Z"},"links":{"citing_paper":"/paper/2505.17086"},"observation_digest":"sha256:fa31ae891e42f1974380d91aafcf47f7cbf89d4198cc330a10ff64d6e57b3001","observation_id":"d8dfacda-bfec-4f13-bf01-362c0cab971e","resolution":{"observed_at":"2026-05-22T13:34:53.810470Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":"10.18653/v1/2023.acl-","metadata_source":"doi_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-03T23:09:00.740362Z","title":"Diverse demonstrations improve in-context compositional generalization","venue":null,"work_id":"d6692343-8429-42f2-aa4d-69c9f7b7cdaa","year":2023},"citing_paper":{"arxiv_id":"2505.17086","last_updated":"2026-04-14T00:27:30Z","snapshot_observed_at":"2026-08-14T10:49:19.013711Z","submitted_at":"2025-05-20T18:33:03Z","title":"Advancing Multi-Agent RAG Systems with Minimalist Reinforcement Learning","version":4},"reference_index":79,"source":"pdf_text","source_observed_at":"2026-05-22T13:34:27.152447Z"},"links":{"citing_paper":"/paper/2505.17086"},"observation_digest":"sha256:2f85f97485010e41c5eb5090d4027c61cf52a1606c3407eba5cbb552b43764bb","observation_id":"116dad29-f9cb-42b0-b061-23f89c84286d","resolution":{"observed_at":"2026-05-22T13:34:52.946232Z","resolver_source":"doi_truncated","status":"malformed_identifier"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":"10.3233/sw-233471","metadata_source":"openalex","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":null,"venue":"Semantic Web","work_id":"a8de2f51-250d-408a-84d3-07e7b5fb1016","year":2024},"citing_paper":{"arxiv_id":"2505.17086","last_updated":"2026-04-14T00:27:30Z","snapshot_observed_at":"2026-08-14T10:49:19.013711Z","submitted_at":"2025-05-20T18:33:03Z","title":"Advancing Multi-Agent RAG Systems with Minimalist Reinforcement Learning","version":4},"reference_index":80,"source":"pdf_text","source_observed_at":"2026-05-22T13:34:27.152447Z"},"links":{"citing_paper":"/paper/2505.17086"},"observation_digest":"sha256:65e78786f7bf4b870434627127d70467c4ec2bb317210854b73035ff5af018db","observation_id":"2a118e1e-8340-4c57-990a-720af121c6dd","resolution":{"observed_at":"2026-05-22T13:34:52.912149Z","resolver_source":"doi","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":null,"venue":null,"work_id":"332e025c-57e0-4ee8-aa7d-ecbbe9fe81ee","year":2014},"citing_paper":{"arxiv_id":"2505.17086","last_updated":"2026-04-14T00:27:30Z","snapshot_observed_at":"2026-08-14T10:49:19.013711Z","submitted_at":"2025-05-20T18:33:03Z","title":"Advancing Multi-Agent RAG Systems with Minimalist Reinforcement Learning","version":4},"reference_index":81,"source":"pdf_text","source_observed_at":"2026-05-22T13:34:27.152447Z"},"links":{"citing_paper":"/paper/2505.17086"},"observation_digest":"sha256:055d594a20b9458d817b548751b4176fa369a173f72c6be9ed94651816867be5","observation_id":"0c3093e0-ab25-4f99-a493-68928a426006","resolution":{"observed_at":"2026-05-22T13:34:53.873564Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2308.13259","last_updated":"2023-10-28T12:19:29Z","snapshot_observed_at":"2026-08-17T04:13:22.823489Z","submitted_at":"2023-08-25T09:23:55Z","title":"Knowledge-Driven CoT: Exploring Faithful Reasoning in LLMs for Knowledge-intensive Question Answering","version":2},"cited_work":{"arxiv_id":"2308.13259","doi":null,"metadata_source":"pith","pith_arxiv_id":"2308.13259","snapshot_observed_at":"2026-07-08T03:04:28.397125Z","title":"Knowledge-driven cot: Exploring faithful reasoning in llms for knowledge-intensive question answering","venue":"cs.CL","work_id":"9c261523-18e1-4ec9-92ad-0425923ef73c","year":2023},"citing_paper":{"arxiv_id":"2505.17086","last_updated":"2026-04-14T00:27:30Z","snapshot_observed_at":"2026-08-14T10:49:19.013711Z","submitted_at":"2025-05-20T18:33:03Z","title":"Advancing Multi-Agent RAG Systems with Minimalist Reinforcement Learning","version":4},"reference_index":82,"source":"pdf_text","source_observed_at":"2026-05-22T13:34:27.152447Z"},"links":{"cited_paper":"/paper/2308.13259","citing_paper":"/paper/2505.17086"},"observation_digest":"sha256:0212459f250f393ed3e5c8cf76f01a01d0af0e026ffa3d509dde2e8f7507c78d","observation_id":"83848d29-549d-4c99-869b-e010215a0e85","resolution":{"observed_at":"2026-05-22T13:34:53.127980Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":null,"venue":null,"work_id":"6f9923be-bb2b-419e-815e-5029ff10dcd1","year":1992},"citing_paper":{"arxiv_id":"2505.17086","last_updated":"2026-04-14T00:27:30Z","snapshot_observed_at":"2026-08-14T10:49:19.013711Z","submitted_at":"2025-05-20T18:33:03Z","title":"Advancing Multi-Agent RAG Systems with Minimalist Reinforcement Learning","version":4},"reference_index":83,"source":"pdf_text","source_observed_at":"2026-05-22T13:34:27.152447Z"},"links":{"citing_paper":"/paper/2505.17086"},"observation_digest":"sha256:7c5819f70b072366cb12244d38ac9a6aa005e91461e527d9131429acf5b17ad6","observation_id":"73d52bed-eb41-4079-8ce1-ed541ba811ab","resolution":{"observed_at":"2026-05-22T13:34:53.892178Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":null,"venue":null,"work_id":"255a6c05-d2fd-4afe-85d1-0436c9830c4d","year":null},"citing_paper":{"arxiv_id":"2505.17086","last_updated":"2026-04-14T00:27:30Z","snapshot_observed_at":"2026-08-14T10:49:19.013711Z","submitted_at":"2025-05-20T18:33:03Z","title":"Advancing Multi-Agent RAG Systems with Minimalist Reinforcement Learning","version":4},"reference_index":84,"source":"pdf_text","source_observed_at":"2026-05-22T13:34:27.152447Z"},"links":{"citing_paper":"/paper/2505.17086"},"observation_digest":"sha256:d0cc27064c5633486d06ab7620907c3f8ea0d9ff85fb18d5232dffa41eb98ef8","observation_id":"85f14fd2-7ca6-4689-ae6b-8f56afd6a595","resolution":{"observed_at":"2026-05-22T13:34:53.850984Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2309.11206","last_updated":"2023-09-21T04:43:46Z","snapshot_observed_at":"2026-08-17T17:49:46.312750Z","submitted_at":"2023-09-20T10:42:08Z","title":"Retrieve-Rewrite-Answer: A KG-to-Text Enhanced LLMs Framework for Knowledge Graph Question Answering","version":2},"cited_work":{"arxiv_id":"2309.11206","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2309.11206","snapshot_observed_at":"2026-07-02T15:57:07.348654Z","title":"Retrieve-rewrite- answer: A kg-to-text enhanced llms framework for knowledge graph question answering","venue":null,"work_id":"aafa10dc-ee79-4e61-8973-43de6090040e","year":2023},"citing_paper":{"arxiv_id":"2505.17086","last_updated":"2026-04-14T00:27:30Z","snapshot_observed_at":"2026-08-14T10:49:19.013711Z","submitted_at":"2025-05-20T18:33:03Z","title":"Advancing Multi-Agent RAG Systems with Minimalist Reinforcement Learning","version":4},"reference_index":85,"source":"pdf_text","source_observed_at":"2026-05-22T13:34:27.152447Z"},"links":{"cited_paper":"/paper/2309.11206","citing_paper":"/paper/2505.17086"},"observation_digest":"sha256:890714ffeb3253a140d2695503c7e02d6f9c01876afa710d2fe41e983658cb06","observation_id":"5635aa0e-60d7-438b-829f-58327abdc44a","resolution":{"observed_at":"2026-05-22T13:34:53.099678Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2504.11343","last_updated":"2025-06-12T06:03:24Z","snapshot_observed_at":"2026-08-16T12:40:48.744732Z","submitted_at":"2025-04-15T16:15:02Z","title":"A Minimalist Approach to LLM Reasoning: from Rejection Sampling to Reinforce","version":2},"cited_work":{"arxiv_id":"2504.11343","doi":null,"metadata_source":"pith","pith_arxiv_id":"2504.11343","snapshot_observed_at":"2026-07-09T04:05:55.456269Z","title":"A minimalist approach to llm reasoning: from rejection sampling to reinforce.arXiv preprint arXiv:2504.11343","venue":"cs.LG","work_id":"90392907-b8b0-4771-9ac8-6cd50245b1dd","year":2025},"citing_paper":{"arxiv_id":"2505.17086","last_updated":"2026-04-14T00:27:30Z","snapshot_observed_at":"2026-08-14T10:49:19.013711Z","submitted_at":"2025-05-20T18:33:03Z","title":"Advancing Multi-Agent RAG Systems with Minimalist Reinforcement Learning","version":4},"reference_index":86,"source":"pdf_text","source_observed_at":"2026-05-22T13:34:27.152447Z"},"links":{"cited_paper":"/paper/2504.11343","citing_paper":"/paper/2505.17086"},"observation_digest":"sha256:936e580997c72f60d574cd926934e5e7001ec6097523ff0e75eea30ac213096d","observation_id":"55773bad-37ca-41b8-a1eb-2acc1865b435","resolution":{"observed_at":"2026-05-22T13:34:53.196041Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":null,"venue":null,"work_id":"b1c81f45-ed90-4795-815f-a82bc25280d2","year":null},"citing_paper":{"arxiv_id":"2505.17086","last_updated":"2026-04-14T00:27:30Z","snapshot_observed_at":"2026-08-14T10:49:19.013711Z","submitted_at":"2025-05-20T18:33:03Z","title":"Advancing Multi-Agent RAG Systems with Minimalist Reinforcement Learning","version":4},"reference_index":87,"source":"pdf_text","source_observed_at":"2026-05-22T13:34:27.152447Z"},"links":{"citing_paper":"/paper/2505.17086"},"observation_digest":"sha256:9a090b217da487061bd162a394d8577c81dd845ea8450e57555820dd6c5c8099","observation_id":"744025e2-7327-4f65-9798-649308419808","resolution":{"observed_at":"2026-05-22T13:34:53.857388Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2412.12643","last_updated":"2025-03-07T07:14:33Z","snapshot_observed_at":"2026-08-17T04:13:47.206236Z","submitted_at":"2024-12-17T08:07:16Z","title":"LLM-based Discriminative Reasoning for Knowledge Graph Question Answering","version":2},"cited_work":{"arxiv_id":"2412.12643","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2412.12643","snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"arXiv:2412.12643 [cs.CL] https://arxiv.org/abs/2412.12643","venue":null,"work_id":"7a5a95ed-3f57-4995-9312-bba74c86e787","year":null},"citing_paper":{"arxiv_id":"2505.17086","last_updated":"2026-04-14T00:27:30Z","snapshot_observed_at":"2026-08-14T10:49:19.013711Z","submitted_at":"2025-05-20T18:33:03Z","title":"Advancing Multi-Agent RAG Systems with Minimalist Reinforcement Learning","version":4},"reference_index":88,"source":"pdf_text","source_observed_at":"2026-05-22T13:34:27.152447Z"},"links":{"cited_paper":"/paper/2412.12643","citing_paper":"/paper/2505.17086"},"observation_digest":"sha256:09843a3a01bfc866c1f28dc6ec0add8bbf1838d27e51eb43a9cebe2cfe4bc49f","observation_id":"26d1666a-6f4c-4031-8025-cbbd37736ba2","resolution":{"observed_at":"2026-05-22T13:34:53.189924Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":"10.18653/v1/2024.emnlp-main.1023","metadata_source":"openalex","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":null,"venue":null,"work_id":"b48fabca-478c-480f-9262-db2337dec8b8","year":2024},"citing_paper":{"arxiv_id":"2505.17086","last_updated":"2026-04-14T00:27:30Z","snapshot_observed_at":"2026-08-14T10:49:19.013711Z","submitted_at":"2025-05-20T18:33:03Z","title":"Advancing Multi-Agent RAG Systems with Minimalist Reinforcement Learning","version":4},"reference_index":89,"source":"pdf_text","source_observed_at":"2026-05-22T13:34:27.152447Z"},"links":{"citing_paper":"/paper/2505.17086"},"observation_digest":"sha256:0c3a1a13fb78753b2e1b0b51f03a977d715620d32872d801a74fff4480fd6efc","observation_id":"c34a6781-781d-4b64-a7a0-0c0878f5ffc8","resolution":{"observed_at":"2026-05-22T13:34:52.953701Z","resolver_source":"doi","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2407.10671","last_updated":"2024-09-10T13:25:53Z","snapshot_observed_at":"2026-08-17T11:08:48.802438Z","submitted_at":"2024-07-15T12:35:42Z","title":"Qwen2 Technical Report","version":4},"cited_work":{"arxiv_id":"2407.10671","doi":"10.18653/v1/2024.naacl-long.246","metadata_source":"pith","pith_arxiv_id":"2407.10671","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Qwen2 Technical Report","venue":"cs.CL","work_id":"a1857881-ab9b-4b80-9b5f-9ae4b5c2566d","year":2024},"citing_paper":{"arxiv_id":"2505.17086","last_updated":"2026-04-14T00:27:30Z","snapshot_observed_at":"2026-08-14T10:49:19.013711Z","submitted_at":"2025-05-20T18:33:03Z","title":"Advancing Multi-Agent RAG Systems with Minimalist Reinforcement Learning","version":4},"reference_index":90,"source":"pdf_text","source_observed_at":"2026-05-22T13:34:27.152447Z"},"links":{"cited_paper":"/paper/2407.10671","citing_paper":"/paper/2505.17086"},"observation_digest":"sha256:6cc49bf01b5dee41ad723221b05c75bbf706d2b0717b062b638db51ef5c3048e","observation_id":"96cb2585-a28b-469f-906f-1e56ba80d457","resolution":{"observed_at":"2026-05-22T13:34:53.154410Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"6772.365776","doi":"10.1145/3626772.3657760","metadata_source":"arxiv_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"InProceedings of the 47th International ACM SIGIR Conference on Research and Development in Information Retrieval (SIGIR)","venue":null,"work_id":"626b8dec-9cf0-47ca-8dd2-9c4bb723aebb","year":2024},"citing_paper":{"arxiv_id":"2505.17086","last_updated":"2026-04-14T00:27:30Z","snapshot_observed_at":"2026-08-14T10:49:19.013711Z","submitted_at":"2025-05-20T18:33:03Z","title":"Advancing Multi-Agent RAG Systems with Minimalist Reinforcement Learning","version":4},"reference_index":91,"source":"pdf_text","source_observed_at":"2026-05-22T13:34:27.152447Z"},"links":{"citing_paper":"/paper/2505.17086"},"observation_digest":"sha256:32f34ad05b293f6758c8b5a9a6e9789b6aa48fff7bc9370d2f58099f2a8bf6bf","observation_id":"bbf6eed6-121f-4527-9d61-d8102f12107a","resolution":{"observed_at":"2026-05-22T13:34:52.938704Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1809.09600","last_updated":"2018-09-25T17:28:20Z","snapshot_observed_at":"2026-08-17T01:54:11.006899Z","submitted_at":"2018-09-25T17:28:20Z","title":"HotpotQA: A Dataset for Diverse, Explainable Multi-hop Question Answering","version":1},"cited_work":{"arxiv_id":"1809.09600","doi":"10.48550/arxiv.1809.09600","metadata_source":"pith","pith_arxiv_id":"1809.09600","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"HotpotQA: A Dataset for Diverse, Explainable Multi-hop Question Answering","venue":"cs.CL","work_id":"c87d7e5f-b81a-41c8-beca-f0b9d598aae4","year":2018},"citing_paper":{"arxiv_id":"2505.17086","last_updated":"2026-04-14T00:27:30Z","snapshot_observed_at":"2026-08-14T10:49:19.013711Z","submitted_at":"2025-05-20T18:33:03Z","title":"Advancing Multi-Agent RAG Systems with Minimalist Reinforcement Learning","version":4},"reference_index":92,"source":"pdf_text","source_observed_at":"2026-05-22T13:34:27.152447Z"},"links":{"cited_paper":"/paper/1809.09600","citing_paper":"/paper/2505.17086"},"observation_digest":"sha256:297ab8bf54f2fa0535356b56f14947f13c6eab237a050b5e9b3b628fce51594e","observation_id":"f1ca34e9-8d19-4c81-8015-61a9d5580aea","resolution":{"observed_at":"2026-05-22T13:34:53.159287Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":null,"venue":null,"work_id":"dff5be6e-f57c-4636-ba46-561d9886355d","year":2023},"citing_paper":{"arxiv_id":"2505.17086","last_updated":"2026-04-14T00:27:30Z","snapshot_observed_at":"2026-08-14T10:49:19.013711Z","submitted_at":"2025-05-20T18:33:03Z","title":"Advancing Multi-Agent RAG Systems with Minimalist Reinforcement Learning","version":4},"reference_index":93,"source":"pdf_text","source_observed_at":"2026-05-22T13:34:27.152447Z"},"links":{"citing_paper":"/paper/2505.17086"},"observation_digest":"sha256:44f0e334741db5c8506722e3e0fcdae935e08407421a872a4fbaf42cd940610b","observation_id":"d2b11e15-31da-40f1-93d4-652075c327c3","resolution":{"observed_at":"2026-05-22T13:34:53.815042Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":null,"venue":null,"work_id":"d21e6bfa-b6d0-44b7-aba8-c084dcd57bfb","year":2023},"citing_paper":{"arxiv_id":"2505.17086","last_updated":"2026-04-14T00:27:30Z","snapshot_observed_at":"2026-08-14T10:49:19.013711Z","submitted_at":"2025-05-20T18:33:03Z","title":"Advancing Multi-Agent RAG Systems with Minimalist Reinforcement Learning","version":4},"reference_index":94,"source":"pdf_text","source_observed_at":"2026-05-22T13:34:27.152447Z"},"links":{"citing_paper":"/paper/2505.17086"},"observation_digest":"sha256:15de05aa91227c70dba02d8e7aaca454246e5028509fa31ca4ecb64e47353e1e","observation_id":"553067e3-c901-4d4e-8ae6-15ec35ae4f9b","resolution":{"observed_at":"2026-05-22T13:34:53.826203Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":null,"venue":null,"work_id":"f66c90af-a4af-4a12-939f-9421a12d138d","year":null},"citing_paper":{"arxiv_id":"2505.17086","last_updated":"2026-04-14T00:27:30Z","snapshot_observed_at":"2026-08-14T10:49:19.013711Z","submitted_at":"2025-05-20T18:33:03Z","title":"Advancing Multi-Agent RAG Systems with Minimalist Reinforcement Learning","version":4},"reference_index":95,"source":"pdf_text","source_observed_at":"2026-05-22T13:34:27.152447Z"},"links":{"citing_paper":"/paper/2505.17086"},"observation_digest":"sha256:5d663ed84c9749f32f633ed0c618f578582e7a5461ef52cc503835563a583ee3","observation_id":"114f9d0c-204a-4d3b-b4f3-de7ccea98f83","resolution":{"observed_at":"2026-05-22T13:34:53.974645Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2410.04343","last_updated":"2025-03-02T19:44:37Z","snapshot_observed_at":"2026-08-17T04:15:37.543157Z","submitted_at":"2024-10-06T03:42:15Z","title":"Inference Scaling for Long-Context Retrieval Augmented Generation","version":2},"cited_work":{"arxiv_id":"2410.04343","doi":null,"metadata_source":"pith","pith_arxiv_id":"2410.04343","snapshot_observed_at":"2026-07-11T03:17:50.738757Z","title":"arXiv:2410.04343 [cs.CL] https://arxiv.org/abs/2410.04343","venue":"cs.CL","work_id":"9e4fec63-85d0-49b9-94ea-6e5f55779d95","year":2024},"citing_paper":{"arxiv_id":"2505.17086","last_updated":"2026-04-14T00:27:30Z","snapshot_observed_at":"2026-08-14T10:49:19.013711Z","submitted_at":"2025-05-20T18:33:03Z","title":"Advancing Multi-Agent RAG Systems with Minimalist Reinforcement Learning","version":4},"reference_index":96,"source":"pdf_text","source_observed_at":"2026-05-22T13:34:27.152447Z"},"links":{"cited_paper":"/paper/2410.04343","citing_paper":"/paper/2505.17086"},"observation_digest":"sha256:8d4650e95575960c1f10c02d83e4f37519ecc563d9e8475305b0373e1019a87c","observation_id":"89b8b538-6fd2-4371-83d3-5370d9340ba5","resolution":{"observed_at":"2026-05-22T13:34:53.100003Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":null,"venue":null,"work_id":"39685d73-7d6b-4a14-a26a-dbe44323664b","year":2022},"citing_paper":{"arxiv_id":"2505.17086","last_updated":"2026-04-14T00:27:30Z","snapshot_observed_at":"2026-08-14T10:49:19.013711Z","submitted_at":"2025-05-20T18:33:03Z","title":"Advancing Multi-Agent RAG Systems with Minimalist Reinforcement Learning","version":4},"reference_index":97,"source":"pdf_text","source_observed_at":"2026-05-22T13:34:27.152447Z"},"links":{"citing_paper":"/paper/2505.17086"},"observation_digest":"sha256:60955abffa7ec4a073a45e8a87928029ab44e9a6e136e876ef24496dddd52ca9","observation_id":"6f642769-e39f-4326-b254-a2ea2e2b33a4","resolution":{"observed_at":"2026-05-22T13:34:53.883215Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":null,"venue":null,"work_id":"ca9b619b-83fe-4b00-94ee-312628b1d1fe","year":null},"citing_paper":{"arxiv_id":"2505.17086","last_updated":"2026-04-14T00:27:30Z","snapshot_observed_at":"2026-08-14T10:49:19.013711Z","submitted_at":"2025-05-20T18:33:03Z","title":"Advancing Multi-Agent RAG Systems with Minimalist Reinforcement Learning","version":4},"reference_index":98,"source":"pdf_text","source_observed_at":"2026-05-22T13:34:27.152447Z"},"links":{"citing_paper":"/paper/2505.17086"},"observation_digest":"sha256:35fa4a53744fe185b1e16e03834b0ce28dfc69c82fd54a748017e1e1137c3915","observation_id":"e701eb92-8fa7-4964-8b84-e16ccf2652f2","resolution":{"observed_at":"2026-05-22T13:34:53.837971Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":"10.18653/v1/2024.naacl-long.96","metadata_source":"openalex","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"End-to-End Beam Retrieval for Multi-Hop Question Answering","venue":null,"work_id":"5f719142-470b-4c4a-b275-c9faea03f568","year":2024},"citing_paper":{"arxiv_id":"2505.17086","last_updated":"2026-04-14T00:27:30Z","snapshot_observed_at":"2026-08-14T10:49:19.013711Z","submitted_at":"2025-05-20T18:33:03Z","title":"Advancing Multi-Agent RAG Systems with Minimalist Reinforcement Learning","version":4},"reference_index":99,"source":"pdf_text","source_observed_at":"2026-05-22T13:34:27.152447Z"},"links":{"citing_paper":"/paper/2505.17086"},"observation_digest":"sha256:7e7a28c96deaa26a6010aba6488e435aab041cfddbcd45a95b0165e9c3e65a1f","observation_id":"d60bc1d6-5595-4421-9139-991e946b924c","resolution":{"observed_at":"2026-05-22T13:34:52.926586Z","resolver_source":"doi","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":null,"venue":null,"work_id":"d8abc91f-5302-4716-9d64-23c1ca7b7671","year":2025},"citing_paper":{"arxiv_id":"2505.17086","last_updated":"2026-04-14T00:27:30Z","snapshot_observed_at":"2026-08-14T10:49:19.013711Z","submitted_at":"2025-05-20T18:33:03Z","title":"Advancing Multi-Agent RAG Systems with Minimalist Reinforcement Learning","version":4},"reference_index":100,"source":"pdf_text","source_observed_at":"2026-05-22T13:34:27.152447Z"},"links":{"citing_paper":"/paper/2505.17086"},"observation_digest":"sha256:2f56fd3e837843def380fb0fab375088be1f41f17764c50cf4928ad80fd0d10d","observation_id":"ea46880a-be4d-4622-b18f-ec5f87dea494","resolution":{"observed_at":"2026-05-22T13:34:53.854075Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2403.10131","last_updated":"2024-06-05T17:27:51Z","snapshot_observed_at":"2026-08-19T11:18:16.512620Z","submitted_at":"2024-03-15T09:26:02Z","title":"RAFT: Adapting Language Model to Domain Specific RAG","version":2},"cited_work":{"arxiv_id":"2403.10131","doi":"10.48550/arxiv.2403.10131","metadata_source":"arxiv_reference","pith_arxiv_id":"2403.10131","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Raft: Adapting language model to domain specific rag","venue":"arXiv (Cornell University)","work_id":"a778bc2e-ab2e-43de-babe-53288bc85919","year":2024},"citing_paper":{"arxiv_id":"2505.17086","last_updated":"2026-04-14T00:27:30Z","snapshot_observed_at":"2026-08-14T10:49:19.013711Z","submitted_at":"2025-05-20T18:33:03Z","title":"Advancing Multi-Agent RAG Systems with Minimalist Reinforcement Learning","version":4},"reference_index":101,"source":"pdf_text","source_observed_at":"2026-05-22T13:34:27.152447Z"},"links":{"cited_paper":"/paper/2403.10131","citing_paper":"/paper/2505.17086"},"observation_digest":"sha256:7c1cd5b7120661dbe21b13eb3f211e11e13d44e3495c76e77b22702251b1263a","observation_id":"54048b82-c392-4f35-874b-a38894ada681","resolution":{"observed_at":"2026-05-22T13:34:53.170772Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}}],"paper":{"arxiv_id":"2505.17086","last_updated":"2026-04-14T00:27:30Z","latest_version":4,"primary_category":"cs.CL","snapshot_observed_at":"2026-08-14T10:49:19.013711Z","submitted_at":"2025-05-20T18:33:03Z","title":"Advancing Multi-Agent RAG Systems with Minimalist Reinforcement Learning"},"reference_resolution":{"displayed":100,"state_counts":{"malformed_identifier":1,"metadata_mismatch":6,"parse_uncertain":0,"unresolved":45,"verified_exact":42,"verified_fuzzy":6},"total_outbound_references":124},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"thesis":"As of 20 August 2026, this Paper Citation Record lists 100 of 124 outbound references and 1 inbound Pith citation observation for arXiv:2505.17086."}