{"as_of":"2026-08-10T02:18:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:1f8bedc05c4ecdc24853c06f14315d1caa728bd66b79eb6bab1cc113edd8bc79","coverage":[{"denominator":18,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":18,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-05T15:17:13.821920Z","state":"measured"},{"denominator":18,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":18,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-09T06:31:02.800959+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2509.03537/citation-record","integrity":"/paper/2509.03537/integrity","json":"/paper/2509.03537/citation-record.json","paper":"/paper/2509.03537"},"outbound":[{"citation":{"cited_paper":{"arxiv_id":"2107.03374","last_updated":"2021-07-14T17:16:02Z","snapshot_observed_at":"2026-08-08T11:58:24.516369Z","submitted_at":"2021-07-07T17:41:24Z","title":"Evaluating Large Language Models Trained on Code","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2107.03374","snapshot_observed_at":"2026-08-05T15:17:13.732880Z","title":null,"venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2509.03537","last_updated":"2025-08-27T17:26:44Z","snapshot_observed_at":"2026-08-09T15:45:12.294838Z","submitted_at":"2025-08-27T17:26:44Z","title":"AR$^2$: Adversarial Reinforcement Learning for Abstract Reasoning in Large Language Models","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-05T15:17:13.732880Z"},"links":{"cited_paper":"/paper/2107.03374","citing_paper":"/paper/2509.03537"},"observation_digest":"sha256:f0858529ff9e6291c796d8ace4cad1154ef3cc8e777fc20f9154478f6b338f0c","observation_id":"5a7a71da-eeb0-4562-b917-d3a509c04373","resolution":{"observed_at":"2026-08-05T15:17:13.732880Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2501.17161","last_updated":"2025-05-26T17:16:45Z","snapshot_observed_at":"2026-08-09T18:26:12.869738Z","submitted_at":"2025-01-28T18:59:44Z","title":"SFT Memorizes, RL Generalizes: A Comparative Study of Foundation Model Post-training","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2501.17161","snapshot_observed_at":"2026-08-05T15:17:13.738630Z","title":"Le, Sergey Levine, and Yi Ma","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2509.03537","last_updated":"2025-08-27T17:26:44Z","snapshot_observed_at":"2026-08-09T15:45:12.294838Z","submitted_at":"2025-08-27T17:26:44Z","title":"AR$^2$: Adversarial Reinforcement Learning for Abstract Reasoning in Large Language Models","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-05T15:17:13.738630Z"},"links":{"cited_paper":"/paper/2501.17161","citing_paper":"/paper/2509.03537"},"observation_digest":"sha256:c3c5d9eb243f759b3bd0aedd3768a8359a82bd30e880fe8275bc530832c262f8","observation_id":"a8e3db9b-6914-4760-826b-fecc9e6486ec","resolution":{"observed_at":"2026-08-05T15:17:13.738630Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2501.12948","last_updated":"2026-01-04T03:57:36Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-01-22T15:19:35Z","title":"DeepSeek-R1: Incentivizing Reasoning Capability in LLMs via Reinforcement Learning","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2501.12948","snapshot_observed_at":"2026-08-05T15:17:13.743935Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2509.03537","last_updated":"2025-08-27T17:26:44Z","snapshot_observed_at":"2026-08-09T15:45:12.294838Z","submitted_at":"2025-08-27T17:26:44Z","title":"AR$^2$: Adversarial Reinforcement Learning for Abstract Reasoning in Large Language Models","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-05T15:17:13.743935Z"},"links":{"cited_paper":"/paper/2501.12948","citing_paper":"/paper/2509.03537"},"observation_digest":"sha256:0bf4e24d044519e8c99e0296acd12df326330b32fee5c297367df874a9b2bec3","observation_id":"b73d0ffa-457b-4b1d-85c5-b595229fe28f","resolution":{"observed_at":"2026-08-05T15:17:13.743935Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2402.01391","last_updated":"2024-02-05T13:28:23Z","snapshot_observed_at":"2026-07-06T17:24:16.787573Z","submitted_at":"2024-02-02T13:14:31Z","title":"StepCoder: Improve Code Generation with Reinforcement Learning from Compiler Feedback","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.01391","snapshot_observed_at":"2026-08-05T15:17:13.749999Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2509.03537","last_updated":"2025-08-27T17:26:44Z","snapshot_observed_at":"2026-08-09T15:45:12.294838Z","submitted_at":"2025-08-27T17:26:44Z","title":"AR$^2$: Adversarial Reinforcement Learning for Abstract Reasoning in Large Language Models","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-05T15:17:13.749999Z"},"links":{"cited_paper":"/paper/2402.01391","citing_paper":"/paper/2509.03537"},"observation_digest":"sha256:ee9957a7cc32c5e15ea8ee60b37359bd67a6e3a58d8b87d44b7edebccba453a6","observation_id":"bbe70dc4-8e78-4d4e-88a8-b072a15b3a7e","resolution":{"observed_at":"2026-08-05T15:17:13.749999Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2502.06807","last_updated":"2025-02-18T22:21:40Z","snapshot_observed_at":"2026-08-09T14:06:29.234036Z","submitted_at":"2025-02-03T23:00:15Z","title":"Competitive Programming with Large Reasoning Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2502.06807","snapshot_observed_at":"2026-08-05T15:17:13.755616Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2509.03537","last_updated":"2025-08-27T17:26:44Z","snapshot_observed_at":"2026-08-09T15:45:12.294838Z","submitted_at":"2025-08-27T17:26:44Z","title":"AR$^2$: Adversarial Reinforcement Learning for Abstract Reasoning in Large Language Models","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-05T15:17:13.755616Z"},"links":{"cited_paper":"/paper/2502.06807","citing_paper":"/paper/2509.03537"},"observation_digest":"sha256:92f69ae8642d99261e3bcd965e612c6c7518d074ad8b7aee196eca0cd8ca7bda","observation_id":"b8753fe9-fef7-4f22-9d23-1e4dc5afc420","resolution":{"observed_at":"2026-08-05T15:17:13.755616Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T15:17:14.117799Z","title":null,"venue":null,"work_id":"b35b9d0a-76a8-45d9-85ca-9979c238b7ae","year":2022},"citing_paper":{"arxiv_id":"2509.03537","last_updated":"2025-08-27T17:26:44Z","snapshot_observed_at":"2026-08-09T15:45:12.294838Z","submitted_at":"2025-08-27T17:26:44Z","title":"AR$^2$: Adversarial Reinforcement Learning for Abstract Reasoning in Large Language Models","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-05T15:17:13.761076Z"},"links":{"citing_paper":"/paper/2509.03537"},"observation_digest":"sha256:7977f9d1d78623109060737367e0ec50be43a1c9e05f468fb5fa439c049d765c","observation_id":"397166e6-a4a4-44d1-8f37-0ffa783c02d6","resolution":{"observed_at":"2026-08-05T15:17:14.122287Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2207.14502","last_updated":"2023-04-12T16:35:27Z","snapshot_observed_at":"2026-07-06T13:36:37.251739Z","submitted_at":"2022-07-29T06:43:28Z","title":"Language Models Can Teach Themselves to Program Better","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2207.14502","snapshot_observed_at":"2026-08-05T15:17:13.766596Z","title":null,"venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2509.03537","last_updated":"2025-08-27T17:26:44Z","snapshot_observed_at":"2026-08-09T15:45:12.294838Z","submitted_at":"2025-08-27T17:26:44Z","title":"AR$^2$: Adversarial Reinforcement Learning for Abstract Reasoning in Large Language Models","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-05T15:17:13.766596Z"},"links":{"cited_paper":"/paper/2207.14502","citing_paper":"/paper/2509.03537"},"observation_digest":"sha256:d522ed12b9c12f16cb33bf0051f62b70920311364e9f5d1ee34502535ad3db26","observation_id":"16e4a717-7845-47c8-b931-7bb989f39dba","resolution":{"observed_at":"2026-08-05T15:17:13.766596Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2409.12186","last_updated":"2024-11-12T13:24:25Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-09-18T17:57:57Z","title":"Qwen2.5-Coder Technical Report","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2409.12186","snapshot_observed_at":"2026-08-05T15:17:13.771367Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2509.03537","last_updated":"2025-08-27T17:26:44Z","snapshot_observed_at":"2026-08-09T15:45:12.294838Z","submitted_at":"2025-08-27T17:26:44Z","title":"AR$^2$: Adversarial Reinforcement Learning for Abstract Reasoning in Large Language Models","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-05T15:17:13.771367Z"},"links":{"cited_paper":"/paper/2409.12186","citing_paper":"/paper/2509.03537"},"observation_digest":"sha256:94132d68784e5eb4bd87073584b81ca197dcb82416773affd69e8b5c96bb7870","observation_id":"f12c963a-9083-4579-8128-fc2233fb8adc","resolution":{"observed_at":"2026-08-05T15:17:13.771367Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2403.07974","last_updated":"2024-06-06T17:41:21Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-03-12T17:58:04Z","title":"LiveCodeBench: Holistic and Contamination Free Evaluation of Large Language Models for Code","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2403.07974","snapshot_observed_at":"2026-08-05T15:17:13.776157Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2509.03537","last_updated":"2025-08-27T17:26:44Z","snapshot_observed_at":"2026-08-09T15:45:12.294838Z","submitted_at":"2025-08-27T17:26:44Z","title":"AR$^2$: Adversarial Reinforcement Learning for Abstract Reasoning in Large Language Models","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-05T15:17:13.776157Z"},"links":{"cited_paper":"/paper/2403.07974","citing_paper":"/paper/2509.03537"},"observation_digest":"sha256:3e33f9afe74360d870cb6dff112819fde7f56441c9b09143f22f78d8f56c6768","observation_id":"5e56cf67-6e4d-4b7c-92ac-30340b4a9d38","resolution":{"observed_at":"2026-08-05T15:17:13.776157Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2503.20783","last_updated":"2025-10-06T09:30:03Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-03-26T17:59:14Z","title":"Understanding R1-Zero-Like Training: A Critical Perspective","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2503.20783","snapshot_observed_at":"2026-08-05T15:17:13.781115Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2509.03537","last_updated":"2025-08-27T17:26:44Z","snapshot_observed_at":"2026-08-09T15:45:12.294838Z","submitted_at":"2025-08-27T17:26:44Z","title":"AR$^2$: Adversarial Reinforcement Learning for Abstract Reasoning in Large Language Models","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-05T15:17:13.781115Z"},"links":{"cited_paper":"/paper/2503.20783","citing_paper":"/paper/2509.03537"},"observation_digest":"sha256:9a09af3b8c9f0a92dd39c746adb9cc5dfa861acb646d27dc1398a03f18149130","observation_id":"944c58a2-a88b-4d2a-9dbe-d3b2c24a94d1","resolution":{"observed_at":"2026-08-05T15:17:13.781115Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2501.01257","last_updated":"2025-01-03T16:36:12Z","snapshot_observed_at":"2026-07-31T19:08:41.925451Z","submitted_at":"2025-01-02T13:49:00Z","title":"CodeElo: Benchmarking Competition-level Code Generation of LLMs with Human-comparable Elo Ratings","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2501.01257","snapshot_observed_at":"2026-08-05T15:17:13.786271Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2509.03537","last_updated":"2025-08-27T17:26:44Z","snapshot_observed_at":"2026-08-09T15:45:12.294838Z","submitted_at":"2025-08-27T17:26:44Z","title":"AR$^2$: Adversarial Reinforcement Learning for Abstract Reasoning in Large Language Models","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-05T15:17:13.786271Z"},"links":{"cited_paper":"/paper/2501.01257","citing_paper":"/paper/2509.03537"},"observation_digest":"sha256:023aea92e08cf1c0720c2c0c850dcbcdcbef767f010650fb78bfd80354eb8b93","observation_id":"bf84de14-32ec-4fa4-bdbf-4020e10daa64","resolution":{"observed_at":"2026-08-05T15:17:13.786271Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2412.15115","last_updated":"2025-01-03T02:18:21Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-12-19T17:56:09Z","title":"Qwen2.5 Technical Report","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2412.15115","snapshot_observed_at":"2026-08-05T15:17:13.791467Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2509.03537","last_updated":"2025-08-27T17:26:44Z","snapshot_observed_at":"2026-08-09T15:45:12.294838Z","submitted_at":"2025-08-27T17:26:44Z","title":"AR$^2$: Adversarial Reinforcement Learning for Abstract Reasoning in Large Language Models","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-05T15:17:13.791467Z"},"links":{"cited_paper":"/paper/2412.15115","citing_paper":"/paper/2509.03537"},"observation_digest":"sha256:c2aff61c7c2d4276e8bfa5f055b30d4409170e07324c4a3d4861246f2184e85c","observation_id":"c5759bce-d896-4232-b2df-88f3d6ad35f4","resolution":{"observed_at":"2026-08-05T15:17:13.791467Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2402.03300","last_updated":"2024-04-27T15:25:53Z","snapshot_observed_at":"2026-08-06T14:58:42.911363Z","submitted_at":"2024-02-05T18:55:32Z","title":"DeepSeekMath: Pushing the Limits of Mathematical Reasoning in Open Language Models","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.03300","snapshot_observed_at":"2026-08-05T15:17:13.797081Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2509.03537","last_updated":"2025-08-27T17:26:44Z","snapshot_observed_at":"2026-08-09T15:45:12.294838Z","submitted_at":"2025-08-27T17:26:44Z","title":"AR$^2$: Adversarial Reinforcement Learning for Abstract Reasoning in Large Language Models","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-05T15:17:13.797081Z"},"links":{"cited_paper":"/paper/2402.03300","citing_paper":"/paper/2509.03537"},"observation_digest":"sha256:af0d9322c87294a98a0d3fe6f52e59ecc099e8ed1ed158b6b63ef52e87154fad","observation_id":"4cf570fe-e19a-413a-98c7-b137748981b8","resolution":{"observed_at":"2026-08-05T15:17:13.797081Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2301.13816","last_updated":"2023-07-19T19:55:31Z","snapshot_observed_at":"2026-08-06T04:20:20.002125Z","submitted_at":"2023-01-31T18:02:26Z","title":"Execution-based Code Generation using Deep Reinforcement Learning","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2301.13816","snapshot_observed_at":"2026-08-05T15:17:13.801965Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2509.03537","last_updated":"2025-08-27T17:26:44Z","snapshot_observed_at":"2026-08-09T15:45:12.294838Z","submitted_at":"2025-08-27T17:26:44Z","title":"AR$^2$: Adversarial Reinforcement Learning for Abstract Reasoning in Large Language Models","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-05T15:17:13.801965Z"},"links":{"cited_paper":"/paper/2301.13816","citing_paper":"/paper/2509.03537"},"observation_digest":"sha256:67baa188088b3be4b830977df448ea0af27f1bbf846292f9ee44f7f8a362668e","observation_id":"826bf715-dc69-4193-92a9-815a966ded12","resolution":{"observed_at":"2026-08-05T15:17:13.801965Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T15:17:14.103256Z","title":"Sutton and Andrew G","venue":null,"work_id":"17861a47-9167-4310-b1be-4aa4fa5d5d7c","year":2018},"citing_paper":{"arxiv_id":"2509.03537","last_updated":"2025-08-27T17:26:44Z","snapshot_observed_at":"2026-08-09T15:45:12.294838Z","submitted_at":"2025-08-27T17:26:44Z","title":"AR$^2$: Adversarial Reinforcement Learning for Abstract Reasoning in Large Language Models","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-05T15:17:13.807366Z"},"links":{"citing_paper":"/paper/2509.03537"},"observation_digest":"sha256:3b8bab60c7a1a348f1cd515997bc48cbd70a487c9fc43222a45e798f0f335543","observation_id":"44eb70b4-099c-4dfc-a3ce-bf381b2e2cd2","resolution":{"observed_at":"2026-08-05T15:17:14.107674Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2412.10400","last_updated":"2025-02-24T08:57:10Z","snapshot_observed_at":"2026-08-07T21:53:28.691375Z","submitted_at":"2024-12-05T16:10:42Z","title":"Reinforcement Learning Enhanced LLMs: A Survey","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2412.10400","snapshot_observed_at":"2026-08-05T15:17:13.811953Z","title":"abcdefg”, then valid words are “faced","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2509.03537","last_updated":"2025-08-27T17:26:44Z","snapshot_observed_at":"2026-08-09T15:45:12.294838Z","submitted_at":"2025-08-27T17:26:44Z","title":"AR$^2$: Adversarial Reinforcement Learning for Abstract Reasoning in Large Language Models","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-05T15:17:13.811953Z"},"links":{"cited_paper":"/paper/2412.10400","citing_paper":"/paper/2509.03537"},"observation_digest":"sha256:745cacdbc512b4e5271f7e12b3ee55ce9c25567e6de7f3e9d6b88c4d528c7673","observation_id":"4337c025-72a6-4375-9146-b13ac84b2cc5","resolution":{"observed_at":"2026-08-05T15:17:13.811953Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T15:17:14.088603Z","title":"the word is a subset of the puzzle’s characters)","venue":null,"work_id":"15d7b766-b7c2-48ea-bd84-ea6ed32579b6","year":null},"citing_paper":{"arxiv_id":"2509.03537","last_updated":"2025-08-27T17:26:44Z","snapshot_observed_at":"2026-08-09T15:45:12.294838Z","submitted_at":"2025-08-27T17:26:44Z","title":"AR$^2$: Adversarial Reinforcement Learning for Abstract Reasoning in Large Language Models","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-05T15:17:13.817245Z"},"links":{"citing_paper":"/paper/2509.03537"},"observation_digest":"sha256:3f35840e61e242953fbe3f8967f1068c6b6f6dcf1eabeef109ef499a1fd042c6","observation_id":"e33c6417-4a03-41ba-be60-dfa7156370dc","resolution":{"observed_at":"2026-08-05T15:17:14.093333Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T15:17:14.071359Z","title":"includes the first character of the puzzle and contains all the characters from the puzzle","venue":null,"work_id":"55f177be-1f9d-40b6-b508-221e1d2a9873","year":null},"citing_paper":{"arxiv_id":"2509.03537","last_updated":"2025-08-27T17:26:44Z","snapshot_observed_at":"2026-08-09T15:45:12.294838Z","submitted_at":"2025-08-27T17:26:44Z","title":"AR$^2$: Adversarial Reinforcement Learning for Abstract Reasoning in Large Language Models","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-05T15:17:13.821920Z"},"links":{"citing_paper":"/paper/2509.03537"},"observation_digest":"sha256:a83700ba888830ccbc497e465d1b63647201fdf177c58e17634306913e3f67c9","observation_id":"3ece2b84-8724-4fa4-a6b2-6345d1d91dd0","resolution":{"observed_at":"2026-08-05T15:17:14.077781Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}}],"paper":{"arxiv_id":"2509.03537","last_updated":"2025-08-27T17:26:44Z","latest_version":1,"primary_category":"cs.CL","snapshot_observed_at":"2026-08-09T15:45:12.294838Z","submitted_at":"2025-08-27T17:26:44Z","title":"AR$^2$: Adversarial Reinforcement Learning for Abstract Reasoning in Large Language Models"},"reference_resolution":{"displayed":18,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":15,"verified_exact":0,"verified_fuzzy":3},"total_outbound_references":18},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"thesis":"As of 10 August 2026, this Paper Citation Record lists 18 of 18 outbound references and 0 inbound Pith citation observations for arXiv:2509.03537."}