{"as_of":"2026-08-18T14:39:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:d5c845f04367b4da5e3fa60bdd92e1e7993a1c0ec445ab92e65040ee7e005dce","coverage":[{"denominator":40,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":40,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-15T17:23:21.085081Z","state":"measured"},{"denominator":42,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":42,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-18T06:34:40.430872+00:00","state":"measured"},{"denominator":2,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":2,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-05T13:20:05.377960Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"pith","source_observed_at":"2026-08-05T13:20:05.555802Z","state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2508.13070","last_updated":"2025-08-18T16:42:55Z","snapshot_observed_at":"2026-08-15T17:13:41.025960Z","submitted_at":"2025-08-18T16:42:55Z","title":"Reinforced Context Order Recovery for Adaptive Reasoning and Planning","version":1},"cited_work":{"arxiv_id":"2508.13070","doi":null,"metadata_source":"pith","pith_arxiv_id":"2508.13070","snapshot_observed_at":"2026-08-05T13:20:05.555802Z","title":"Reinforced Context Order Recovery for Adaptive Reasoning and Planning","venue":"cs.CL","work_id":"3179c947-a685-4445-8b13-b6518c575131","year":2025},"citing_paper":{"arxiv_id":"2509.01025","last_updated":"2025-09-07T22:48:13Z","snapshot_observed_at":"2026-08-16T22:18:38.054720Z","submitted_at":"2025-08-31T23:34:53Z","title":"Any-Order Flexible Length Masked Diffusion","version":2},"reference_index":50,"source":"arxiv_source","source_observed_at":"2026-08-05T13:20:05.377960Z"},"links":{"cited_paper":"/paper/2508.13070","citing_paper":"/paper/2509.01025"},"observation_digest":"sha256:d4224e9336bdbb35ced3f4ad3b4d12d64c485240788cbf54394046a8ea75bb7a","observation_id":"81703caa-0f45-45cb-aeae-62c064ed6958","resolution":{"observed_at":"2026-08-05T13:20:05.561020Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2508.13070","last_updated":"2025-08-18T16:42:55Z","snapshot_observed_at":"2026-08-15T17:13:41.025960Z","submitted_at":"2025-08-18T16:42:55Z","title":"Reinforced Context Order Recovery for Adaptive Reasoning and Planning","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2508.13070","snapshot_observed_at":"2026-08-01T14:25:38.146508Z","title":"arXiv preprint arXiv:2508.13070 , year=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.26504","last_updated":"2026-08-09T19:34:25Z","snapshot_observed_at":"2026-08-14T06:58:43.954033Z","submitted_at":"2026-07-29T06:09:12Z","title":"From Interface to Inference: Eliciting Any-Order Inference from Any-Order Models","version":1},"reference_index":25,"source":"arxiv_source","source_observed_at":"2026-08-01T14:25:38.146508Z"},"links":{"cited_paper":"/paper/2508.13070","citing_paper":"/paper/2607.26504"},"observation_digest":"sha256:17a460de79b9deac5993c2f1939db7ad07220cc68a575e51b201af83d421b948","observation_id":"74d45714-c8de-4082-b695-fa2c9fc97465","resolution":{"observed_at":"2026-08-01T14:25:38.146508Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"links":{"evidence":"/evidence","html":"/paper/2508.13070/citation-record","integrity":"/paper/2508.13070/integrity","json":"/paper/2508.13070/citation-record.json","paper":"/paper/2508.13070"},"outbound":[{"citation":{"cited_paper":{"arxiv_id":"2303.08774","last_updated":"2024-03-04T06:01:33Z","snapshot_observed_at":"2026-08-17T09:58:46.058102Z","submitted_at":"2023-03-15T17:15:04Z","title":"GPT-4 Technical Report","version":6},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2303.08774","snapshot_observed_at":"2026-08-15T17:23:20.320451Z","title":"Gpt-4 technical report","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2508.13070","last_updated":"2025-08-18T16:42:55Z","snapshot_observed_at":"2026-08-15T17:13:41.025960Z","submitted_at":"2025-08-18T16:42:55Z","title":"Reinforced Context Order Recovery for Adaptive Reasoning and Planning","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-15T17:23:20.320451Z"},"links":{"cited_paper":"/paper/2303.08774","citing_paper":"/paper/2508.13070"},"observation_digest":"sha256:4bb03c6870c29bf181757115f6a2ef723cb4df04e936dcfc85e5ea356d48425b","observation_id":"7469ccae-3677-4bb7-87b5-911ffedba46c","resolution":{"observed_at":"2026-08-15T17:23:20.320451Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2307.09288","last_updated":"2023-07-19T17:08:59Z","snapshot_observed_at":"2026-08-07T12:56:43.323460Z","submitted_at":"2023-07-18T14:31:57Z","title":"Llama 2: Open Foundation and Fine-Tuned Chat Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2307.09288","snapshot_observed_at":"2026-08-15T17:23:20.325984Z","title":"Llama 2: Open foundation and fine-tuned chat models","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2508.13070","last_updated":"2025-08-18T16:42:55Z","snapshot_observed_at":"2026-08-15T17:13:41.025960Z","submitted_at":"2025-08-18T16:42:55Z","title":"Reinforced Context Order Recovery for Adaptive Reasoning and Planning","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-15T17:23:20.325984Z"},"links":{"cited_paper":"/paper/2307.09288","citing_paper":"/paper/2508.13070"},"observation_digest":"sha256:87a7d3535dd84c1d0078ca279997357401ded4fd3fb9960fe4f20e4e3d377f9c","observation_id":"84f7b816-81c1-43d3-a1cd-0561871b180e","resolution":{"observed_at":"2026-08-15T17:23:20.325984Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2312.11805","last_updated":"2025-05-09T21:04:06Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2023-12-19T02:39:27Z","title":"Gemini: A Family of Highly Capable Multimodal Models","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2312.11805","snapshot_observed_at":"2026-08-15T17:23:20.331158Z","title":"Gemini: a family of highly capable multimodal models","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2508.13070","last_updated":"2025-08-18T16:42:55Z","snapshot_observed_at":"2026-08-15T17:13:41.025960Z","submitted_at":"2025-08-18T16:42:55Z","title":"Reinforced Context Order Recovery for Adaptive Reasoning and Planning","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-15T17:23:20.331158Z"},"links":{"cited_paper":"/paper/2312.11805","citing_paper":"/paper/2508.13070"},"observation_digest":"sha256:45c666f359d6820b6a6458b94cbb625619360a11e8a5ea162ad473ca340b26d4","observation_id":"86c64d48-c37f-4339-b76d-8c5cfd9b8312","resolution":{"observed_at":"2026-08-15T17:23:20.331158Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T17:23:20.336717Z","title":"Argmax flows and multinomial diffusion: Learning categorical distributions","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2508.13070","last_updated":"2025-08-18T16:42:55Z","snapshot_observed_at":"2026-08-15T17:13:41.025960Z","submitted_at":"2025-08-18T16:42:55Z","title":"Reinforced Context Order Recovery for Adaptive Reasoning and Planning","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-15T17:23:20.336717Z"},"links":{"citing_paper":"/paper/2508.13070"},"observation_digest":"sha256:0ec02fdcd8714ab724d34f7961b822d76af6f234362a64b8105d37b19aa7a494","observation_id":"298d0bbc-b325-420f-87da-ef90f1186c25","resolution":{"observed_at":"2026-08-15T17:23:20.336717Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T17:23:20.342151Z","title":"Structured denoising diffusion models in discrete state-spaces","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2508.13070","last_updated":"2025-08-18T16:42:55Z","snapshot_observed_at":"2026-08-15T17:13:41.025960Z","submitted_at":"2025-08-18T16:42:55Z","title":"Reinforced Context Order Recovery for Adaptive Reasoning and Planning","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-15T17:23:20.342151Z"},"links":{"citing_paper":"/paper/2508.13070"},"observation_digest":"sha256:59713e5638f5f39472132eccc041a48ab3a159793daa952a46c0eed5dd5c86bc","observation_id":"c905a289-a497-4ea0-80a7-5875453e0f27","resolution":{"observed_at":"2026-08-15T17:23:20.342151Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2502.09992","last_updated":"2025-10-18T15:35:05Z","snapshot_observed_at":"2026-08-04T04:34:22.998376Z","submitted_at":"2025-02-14T08:23:51Z","title":"Large Language Diffusion Models","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2502.09992","snapshot_observed_at":"2026-08-15T17:23:20.348659Z","title":"Large language diffusion models","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2508.13070","last_updated":"2025-08-18T16:42:55Z","snapshot_observed_at":"2026-08-15T17:13:41.025960Z","submitted_at":"2025-08-18T16:42:55Z","title":"Reinforced Context Order Recovery for Adaptive Reasoning and Planning","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-15T17:23:20.348659Z"},"links":{"cited_paper":"/paper/2502.09992","citing_paper":"/paper/2508.13070"},"observation_digest":"sha256:1349ac63e0bbc149878e8cfda562158f695bd536a76af560769ea1bfd27fe3c6","observation_id":"d13b7f15-35ac-4834-b368-1e01708ef52f","resolution":{"observed_at":"2026-08-15T17:23:20.348659Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T17:23:20.399436Z","title":"Chain-of-thought prompting elicits reasoning in large language models","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2508.13070","last_updated":"2025-08-18T16:42:55Z","snapshot_observed_at":"2026-08-15T17:13:41.025960Z","submitted_at":"2025-08-18T16:42:55Z","title":"Reinforced Context Order Recovery for Adaptive Reasoning and Planning","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-15T17:23:20.399436Z"},"links":{"citing_paper":"/paper/2508.13070"},"observation_digest":"sha256:dd6e00147e474f1c9906cdbeaba9582fd360ad6d1a8d40d41b1df2618246ef62","observation_id":"e47bdb06-d1c3-4c0e-a73e-51ef882f48e5","resolution":{"observed_at":"2026-08-15T17:23:20.399436Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T17:23:20.444145Z","title":"A survey on large language model based autonomous agents","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2508.13070","last_updated":"2025-08-18T16:42:55Z","snapshot_observed_at":"2026-08-15T17:13:41.025960Z","submitted_at":"2025-08-18T16:42:55Z","title":"Reinforced Context Order Recovery for Adaptive Reasoning and Planning","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-15T17:23:20.444145Z"},"links":{"citing_paper":"/paper/2508.13070"},"observation_digest":"sha256:029205eae870cb83845ec53b6a65a1086196a9ebbb360b068c883abf27f42fe3","observation_id":"01175fc7-6e22-46e9-9b34-17927bc7b5c0","resolution":{"observed_at":"2026-08-15T17:23:20.444145Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2401.14196","last_updated":"2024-01-26T09:23:11Z","snapshot_observed_at":"2026-08-06T22:40:28.707813Z","submitted_at":"2024-01-25T14:17:53Z","title":"DeepSeek-Coder: When the Large Language Model Meets Programming -- The Rise of Code Intelligence","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2401.14196","snapshot_observed_at":"2026-08-15T17:23:20.448688Z","title":"Deepseek-coder: When the large language model meets programming–the rise of code intelligence","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2508.13070","last_updated":"2025-08-18T16:42:55Z","snapshot_observed_at":"2026-08-15T17:13:41.025960Z","submitted_at":"2025-08-18T16:42:55Z","title":"Reinforced Context Order Recovery for Adaptive Reasoning and Planning","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-15T17:23:20.448688Z"},"links":{"cited_paper":"/paper/2401.14196","citing_paper":"/paper/2508.13070"},"observation_digest":"sha256:0c8a650ddef9bb247eafdc3aeadbe5cdd079f255d7e695e3f025b5795e470b13","observation_id":"b09cb030-f1f0-4d84-a133-f51039183d36","resolution":{"observed_at":"2026-08-15T17:23:20.448688Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T17:23:22.389674Z","title":"Causal language modeling can elicit search and reasoning capabilities on logic puzzles","venue":null,"work_id":"0d6e6d8a-735f-411f-bfb3-1fb7aea3cdf4","year":2024},"citing_paper":{"arxiv_id":"2508.13070","last_updated":"2025-08-18T16:42:55Z","snapshot_observed_at":"2026-08-15T17:13:41.025960Z","submitted_at":"2025-08-18T16:42:55Z","title":"Reinforced Context Order Recovery for Adaptive Reasoning and Planning","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-15T17:23:20.453606Z"},"links":{"citing_paper":"/paper/2508.13070"},"observation_digest":"sha256:f6e704d00431ace5bc2c7224f858b792d793033dcde57d1aef445622f64b93ba","observation_id":"54bf7b2c-4eb5-43b7-8411-c679b471634c","resolution":{"observed_at":"2026-08-15T17:23:22.395704Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T17:23:22.370002Z","title":"Beyond autoregression: Discrete diffusion for complex reasoning and planning","venue":null,"work_id":"2adb2fbd-8be3-4f09-b618-149f7f8655dd","year":2025},"citing_paper":{"arxiv_id":"2508.13070","last_updated":"2025-08-18T16:42:55Z","snapshot_observed_at":"2026-08-15T17:13:41.025960Z","submitted_at":"2025-08-18T16:42:55Z","title":"Reinforced Context Order Recovery for Adaptive Reasoning and Planning","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-15T17:23:20.459325Z"},"links":{"citing_paper":"/paper/2508.13070"},"observation_digest":"sha256:5db38b1de854ffdab62d3a1b14b98d1a2fcfcb2224be6f3f4361ffd7d59d8f9a","observation_id":"965622e3-4e8f-4ce2-a5fc-254e3f6b7f85","resolution":{"observed_at":"2026-08-15T17:23:22.375745Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2502.06768","last_updated":"2025-08-19T23:35:57Z","snapshot_observed_at":"2026-08-13T15:59:25.224905Z","submitted_at":"2025-02-10T18:47:21Z","title":"Train for the Worst, Plan for the Best: Understanding Token Ordering in Masked Diffusions","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2502.06768","snapshot_observed_at":"2026-08-15T17:23:20.464947Z","title":"Train for the worst, plan for the best: Understanding token ordering in masked diffusions","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2508.13070","last_updated":"2025-08-18T16:42:55Z","snapshot_observed_at":"2026-08-15T17:13:41.025960Z","submitted_at":"2025-08-18T16:42:55Z","title":"Reinforced Context Order Recovery for Adaptive Reasoning and Planning","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-15T17:23:20.464947Z"},"links":{"cited_paper":"/paper/2502.06768","citing_paper":"/paper/2508.13070"},"observation_digest":"sha256:03358b8b6cf8d7335d286e5291b62a110909768b31475a50a2d8e1112e29bb92","observation_id":"05cf2003-d321-41ff-8fe1-09d15a573e3f","resolution":{"observed_at":"2026-08-15T17:23:20.464947Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T17:23:20.470797Z","title":"Diffusion models: A comprehensive survey of methods and applications","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2508.13070","last_updated":"2025-08-18T16:42:55Z","snapshot_observed_at":"2026-08-15T17:13:41.025960Z","submitted_at":"2025-08-18T16:42:55Z","title":"Reinforced Context Order Recovery for Adaptive Reasoning and Planning","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-15T17:23:20.470797Z"},"links":{"citing_paper":"/paper/2508.13070"},"observation_digest":"sha256:a73d75e654e6305f1ff19d7caf592072c5cadc446a0dc374b89f1ae7dad65316","observation_id":"9b497e3b-73ed-4ad7-a8e6-244403d68f4c","resolution":{"observed_at":"2026-08-15T17:23:20.470797Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T17:23:22.227533Z","title":"A survey on generative diffusion models","venue":null,"work_id":"b920d89c-e9fe-4967-8a69-5c49aafde24f","year":2024},"citing_paper":{"arxiv_id":"2508.13070","last_updated":"2025-08-18T16:42:55Z","snapshot_observed_at":"2026-08-15T17:13:41.025960Z","submitted_at":"2025-08-18T16:42:55Z","title":"Reinforced Context Order Recovery for Adaptive Reasoning and Planning","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-15T17:23:20.475682Z"},"links":{"citing_paper":"/paper/2508.13070"},"observation_digest":"sha256:e745267c51e006e59f0351eee60298ba35bff0ffd28df851718bb0e6f016cf2c","observation_id":"9a211638-26ef-4dbb-8f77-6d104cb1f768","resolution":{"observed_at":"2026-08-15T17:23:22.315211Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2411.05902","last_updated":"2025-05-31T13:35:55Z","snapshot_observed_at":"2026-08-16T13:01:41.574512Z","submitted_at":"2024-11-08T17:15:12Z","title":"Autoregressive Models in Vision: A Survey","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2411.05902","snapshot_observed_at":"2026-08-15T17:23:20.480169Z","title":"Autoregressive models in vision: A survey","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2508.13070","last_updated":"2025-08-18T16:42:55Z","snapshot_observed_at":"2026-08-15T17:13:41.025960Z","submitted_at":"2025-08-18T16:42:55Z","title":"Reinforced Context Order Recovery for Adaptive Reasoning and Planning","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-15T17:23:20.480169Z"},"links":{"cited_paper":"/paper/2411.05902","citing_paper":"/paper/2508.13070"},"observation_digest":"sha256:bf78a7a475cea8ceb6800673e8ba939c564f3b42a031107628ab149c860d96bd","observation_id":"5ccadcb1-b9c3-4187-8069-e6163e26585e","resolution":{"observed_at":"2026-08-15T17:23:20.480169Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T17:23:20.484472Z","title":"Language models are unsupervised multitask learners","venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2508.13070","last_updated":"2025-08-18T16:42:55Z","snapshot_observed_at":"2026-08-15T17:13:41.025960Z","submitted_at":"2025-08-18T16:42:55Z","title":"Reinforced Context Order Recovery for Adaptive Reasoning and Planning","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-15T17:23:20.484472Z"},"links":{"citing_paper":"/paper/2508.13070"},"observation_digest":"sha256:dc66c6c3c5f95e221534127f668a13435abf3447ee6a70230319caac4486720b","observation_id":"abdb9721-fe84-40ae-b71d-0d37a25bb70e","resolution":{"observed_at":"2026-08-15T17:23:20.484472Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T17:23:20.488934Z","title":"Language models are few-shot learners","venue":null,"work_id":null,"year":1901},"citing_paper":{"arxiv_id":"2508.13070","last_updated":"2025-08-18T16:42:55Z","snapshot_observed_at":"2026-08-15T17:13:41.025960Z","submitted_at":"2025-08-18T16:42:55Z","title":"Reinforced Context Order Recovery for Adaptive Reasoning and Planning","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-15T17:23:20.488934Z"},"links":{"citing_paper":"/paper/2508.13070"},"observation_digest":"sha256:be8a083fc6b45797a33fb47431c6a9f59f3469f06adf790c0ef1d37d9afa4bad","observation_id":"be4b17bb-5f69-4c0c-9cd8-52ac8caa2388","resolution":{"observed_at":"2026-08-15T17:23:20.488934Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T17:23:20.536615Z","title":"Denoising diffusion probabilistic models","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2508.13070","last_updated":"2025-08-18T16:42:55Z","snapshot_observed_at":"2026-08-15T17:13:41.025960Z","submitted_at":"2025-08-18T16:42:55Z","title":"Reinforced Context Order Recovery for Adaptive Reasoning and Planning","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-15T17:23:20.536615Z"},"links":{"citing_paper":"/paper/2508.13070"},"observation_digest":"sha256:354f5ba2cec9c03b446bb9c93ea0f76c3d1e18864b9ada7c7764d20df6067620","observation_id":"d0475881-861e-4b2e-9029-8b0282ac115a","resolution":{"observed_at":"2026-08-15T17:23:20.536615Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T17:23:20.623190Z","title":"Generative modeling by estimating gradients of the data distribution","venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2508.13070","last_updated":"2025-08-18T16:42:55Z","snapshot_observed_at":"2026-08-15T17:13:41.025960Z","submitted_at":"2025-08-18T16:42:55Z","title":"Reinforced Context Order Recovery for Adaptive Reasoning and Planning","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-15T17:23:20.623190Z"},"links":{"citing_paper":"/paper/2508.13070"},"observation_digest":"sha256:d283a77d4a2452026c96e44662c60a9816b6e398b3ed6750c9e6c62b2107eb45","observation_id":"4f1f215f-056e-4198-b523-ae0bddb910a2","resolution":{"observed_at":"2026-08-15T17:23:20.623190Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T17:23:20.627154Z","title":"Score-based generative modeling through stochastic differential equations","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2508.13070","last_updated":"2025-08-18T16:42:55Z","snapshot_observed_at":"2026-08-15T17:13:41.025960Z","submitted_at":"2025-08-18T16:42:55Z","title":"Reinforced Context Order Recovery for Adaptive Reasoning and Planning","version":1},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-15T17:23:20.627154Z"},"links":{"citing_paper":"/paper/2508.13070"},"observation_digest":"sha256:d75544e23e2b295cdabbfd96baa08f7464e96f168d9cde119aff9e40ab714c61","observation_id":"20286b7d-3b56-47e5-b2ea-dce477f2527b","resolution":{"observed_at":"2026-08-15T17:23:20.627154Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T17:23:20.631845Z","title":"Xlnet: Generalized autoregressive pretraining for language understanding","venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2508.13070","last_updated":"2025-08-18T16:42:55Z","snapshot_observed_at":"2026-08-15T17:13:41.025960Z","submitted_at":"2025-08-18T16:42:55Z","title":"Reinforced Context Order Recovery for Adaptive Reasoning and Planning","version":1},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-15T17:23:20.631845Z"},"links":{"citing_paper":"/paper/2508.13070"},"observation_digest":"sha256:1483eb21da09856eb1126faba2ed64a3b976ff4b7d6199ea842828ec49593291","observation_id":"fbb6b1e1-0dbd-40c8-be9d-d503b23bb464","resolution":{"observed_at":"2026-08-15T17:23:20.631845Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T17:23:22.126367Z","title":"Training and inference on any-order autoregres- sive models the right way","venue":null,"work_id":"cf863675-ecd8-470d-a64f-aabdd743f35d","year":2022},"citing_paper":{"arxiv_id":"2508.13070","last_updated":"2025-08-18T16:42:55Z","snapshot_observed_at":"2026-08-15T17:13:41.025960Z","submitted_at":"2025-08-18T16:42:55Z","title":"Reinforced Context Order Recovery for Adaptive Reasoning and Planning","version":1},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-15T17:23:20.636751Z"},"links":{"citing_paper":"/paper/2508.13070"},"observation_digest":"sha256:db892042d53f0d644002a582d247c63a239a54da37b6108331265524da5b9b0e","observation_id":"dc348384-e46b-41f0-8dc1-baeae72b1fed","resolution":{"observed_at":"2026-08-15T17:23:22.132496Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T17:23:20.641147Z","title":"Faith and fate: Limits of transformers on compositionality","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2508.13070","last_updated":"2025-08-18T16:42:55Z","snapshot_observed_at":"2026-08-15T17:13:41.025960Z","submitted_at":"2025-08-18T16:42:55Z","title":"Reinforced Context Order Recovery for Adaptive Reasoning and Planning","version":1},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-15T17:23:20.641147Z"},"links":{"citing_paper":"/paper/2508.13070"},"observation_digest":"sha256:8a56e9b0b69d44912b2cedd71666514c3b739f31a1bc489580945c0ab7df12a1","observation_id":"8b4bec0d-bd87-41f6-a420-cd0c046bd30d","resolution":{"observed_at":"2026-08-15T17:23:20.641147Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T17:23:22.014885Z","title":"The pitfalls of next-token prediction","venue":null,"work_id":"9a5c187a-d09e-4055-9cd5-fb74b573c071","year":2024},"citing_paper":{"arxiv_id":"2508.13070","last_updated":"2025-08-18T16:42:55Z","snapshot_observed_at":"2026-08-15T17:13:41.025960Z","submitted_at":"2025-08-18T16:42:55Z","title":"Reinforced Context Order Recovery for Adaptive Reasoning and Planning","version":1},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-15T17:23:20.645817Z"},"links":{"citing_paper":"/paper/2508.13070"},"observation_digest":"sha256:75a4ece21f4c8e0fc44a04218652a8f56139afc487fe8d65b0c5e9e93dedacae","observation_id":"efa3cb39-95eb-419e-a77a-36cc8eb1636d","resolution":{"observed_at":"2026-08-15T17:23:22.076460Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2305.12272","last_updated":"2023-05-20T19:29:47Z","snapshot_observed_at":"2026-08-16T15:31:26.849749Z","submitted_at":"2023-05-20T19:29:47Z","title":"Autoregressive Modeling with Lookahead Attention","version":1},"cited_work":{"arxiv_id":"2305.12272","doi":null,"metadata_source":"pith","pith_arxiv_id":"2305.12272","snapshot_observed_at":"2026-08-15T17:23:21.384743Z","title":"Autoregressive Modeling with Lookahead Attention","venue":"cs.CL","work_id":"6412af61-5d50-4a2c-8fa7-3674d758cb15","year":2023},"citing_paper":{"arxiv_id":"2508.13070","last_updated":"2025-08-18T16:42:55Z","snapshot_observed_at":"2026-08-15T17:13:41.025960Z","submitted_at":"2025-08-18T16:42:55Z","title":"Reinforced Context Order Recovery for Adaptive Reasoning and Planning","version":1},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-08-15T17:23:20.650030Z"},"links":{"cited_paper":"/paper/2305.12272","citing_paper":"/paper/2508.13070"},"observation_digest":"sha256:6e59217ec8ca0cf8f48089d4fcfc715d9d2d2938009f60ab19c5dbdb80a42f79","observation_id":"74239063-28d0-4d2d-a627-0f40d31a1492","resolution":{"observed_at":"2026-08-15T17:23:21.396791Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T17:23:21.859347Z","title":"On the planning abilities of large language models-a critical investigation","venue":null,"work_id":"d241a6d3-3de3-48ec-aa46-34320546fa56","year":2023},"citing_paper":{"arxiv_id":"2508.13070","last_updated":"2025-08-18T16:42:55Z","snapshot_observed_at":"2026-08-15T17:13:41.025960Z","submitted_at":"2025-08-18T16:42:55Z","title":"Reinforced Context Order Recovery for Adaptive Reasoning and Planning","version":1},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-08-15T17:23:20.654527Z"},"links":{"citing_paper":"/paper/2508.13070"},"observation_digest":"sha256:1dfa731099121235636790ed9b07a117caf3bce668d70ff8bd0067a46eed3f73","observation_id":"da8841ae-d26d-408e-bf5b-0a81161f3fce","resolution":{"observed_at":"2026-08-15T17:23:21.915113Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T17:23:21.843891Z","title":"Position: LLMs can’t plan, but can help planning in LLM-modulo frameworks","venue":null,"work_id":"e917104b-fc86-4e26-b6d4-ad52dd7ac2f2","year":2024},"citing_paper":{"arxiv_id":"2508.13070","last_updated":"2025-08-18T16:42:55Z","snapshot_observed_at":"2026-08-15T17:13:41.025960Z","submitted_at":"2025-08-18T16:42:55Z","title":"Reinforced Context Order Recovery for Adaptive Reasoning and Planning","version":1},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-08-15T17:23:20.751591Z"},"links":{"citing_paper":"/paper/2508.13070"},"observation_digest":"sha256:c0231aee0adb5181a646a1aae6eb848f9ba099fa00c6f0ae3c2e5b63f99b24af","observation_id":"e6d8d945-1483-4d39-8439-bd2e859162b9","resolution":{"observed_at":"2026-08-15T17:23:21.848871Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T17:23:20.876473Z","title":"Chain of thought empowers transformers to solve inherently serial problems","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2508.13070","last_updated":"2025-08-18T16:42:55Z","snapshot_observed_at":"2026-08-15T17:13:41.025960Z","submitted_at":"2025-08-18T16:42:55Z","title":"Reinforced Context Order Recovery for Adaptive Reasoning and Planning","version":1},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-08-15T17:23:20.876473Z"},"links":{"citing_paper":"/paper/2508.13070"},"observation_digest":"sha256:cf7748c362dc0c01d77aee65a617f46d692a9b6a6937e7d81b576676eaef82eb","observation_id":"3521d35e-cb3a-40ac-91ac-257051d4cad7","resolution":{"observed_at":"2026-08-15T17:23:20.876473Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T17:23:20.908203Z","title":"Discrete diffusion modeling by estimating the ratios of the data distribution","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2508.13070","last_updated":"2025-08-18T16:42:55Z","snapshot_observed_at":"2026-08-15T17:13:41.025960Z","submitted_at":"2025-08-18T16:42:55Z","title":"Reinforced Context Order Recovery for Adaptive Reasoning and Planning","version":1},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-08-15T17:23:20.908203Z"},"links":{"citing_paper":"/paper/2508.13070"},"observation_digest":"sha256:9d83226cf506cbd36c92f49cfcbbbcb68e410778848391d7a02e6a05a54c73be","observation_id":"8efeed51-41c7-433a-be23-f0476711b8ad","resolution":{"observed_at":"2026-08-15T17:23:20.908203Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T17:23:21.800565Z","title":"A theory of usable information under computational constraints","venue":null,"work_id":"6bf00cbc-63c8-444c-af5e-6871a2c68c1b","year":2020},"citing_paper":{"arxiv_id":"2508.13070","last_updated":"2025-08-18T16:42:55Z","snapshot_observed_at":"2026-08-15T17:13:41.025960Z","submitted_at":"2025-08-18T16:42:55Z","title":"Reinforced Context Order Recovery for Adaptive Reasoning and Planning","version":1},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-08-15T17:23:20.913133Z"},"links":{"citing_paper":"/paper/2508.13070"},"observation_digest":"sha256:9a3388167a11740175c76eacff90a062aba46ce1a57486d1f00511c08e6bbfdf","observation_id":"25fa6405-107a-44ac-a6a3-7aac8e209cd6","resolution":{"observed_at":"2026-08-15T17:23:21.805862Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T17:23:21.776693Z","title":"On the shortest arborescence of a directed graph.Scientia Sinica, 14:1396–1400, 1965","venue":null,"work_id":"b81e17ee-d755-43b9-8125-6645579aefde","year":1965},"citing_paper":{"arxiv_id":"2508.13070","last_updated":"2025-08-18T16:42:55Z","snapshot_observed_at":"2026-08-15T17:13:41.025960Z","submitted_at":"2025-08-18T16:42:55Z","title":"Reinforced Context Order Recovery for Adaptive Reasoning and Planning","version":1},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-08-15T17:23:20.917949Z"},"links":{"citing_paper":"/paper/2508.13070"},"observation_digest":"sha256:01bcfaf5064db4a0d75a7973158c0978c20b22f317f24e9436c2568a075f52e2","observation_id":"273a925d-a8fb-467e-8026-0f063e74dfd3","resolution":{"observed_at":"2026-08-15T17:23:21.789977Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T17:23:20.922686Z","title":"Reinforcement learning: An introduction","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2508.13070","last_updated":"2025-08-18T16:42:55Z","snapshot_observed_at":"2026-08-15T17:13:41.025960Z","submitted_at":"2025-08-18T16:42:55Z","title":"Reinforced Context Order Recovery for Adaptive Reasoning and Planning","version":1},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-08-15T17:23:20.922686Z"},"links":{"citing_paper":"/paper/2508.13070"},"observation_digest":"sha256:9a08b42ba20996c06ab2f0c9edb0b0c3d45d44145c7b4dc507eea152a6de7dcd","observation_id":"dcf4f9d5-7aa3-4bbe-8f44-ad6d3b4e0ab2","resolution":{"observed_at":"2026-08-15T17:23:20.922686Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T17:23:20.926708Z","title":"Reinforcement learning with deep energy-based policies","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2508.13070","last_updated":"2025-08-18T16:42:55Z","snapshot_observed_at":"2026-08-15T17:13:41.025960Z","submitted_at":"2025-08-18T16:42:55Z","title":"Reinforced Context Order Recovery for Adaptive Reasoning and Planning","version":1},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-08-15T17:23:20.926708Z"},"links":{"citing_paper":"/paper/2508.13070"},"observation_digest":"sha256:59d5b560c20e4a7c7d2e4f0ff871db4aa843ea8eb34c3bb9a8b3e3b8117cbc26","observation_id":"1083529e-3d01-4309-a996-3368cd70d481","resolution":{"observed_at":"2026-08-15T17:23:20.926708Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1707.06347","last_updated":"2017-08-28T09:20:06Z","snapshot_observed_at":"2026-08-15T20:26:32.102285Z","submitted_at":"2017-07-20T02:32:33Z","title":"Proximal Policy Optimization Algorithms","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1707.06347","snapshot_observed_at":"2026-08-15T17:23:20.931444Z","title":"Proximal policy optimization algorithms","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2508.13070","last_updated":"2025-08-18T16:42:55Z","snapshot_observed_at":"2026-08-15T17:13:41.025960Z","submitted_at":"2025-08-18T16:42:55Z","title":"Reinforced Context Order Recovery for Adaptive Reasoning and Planning","version":1},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-08-15T17:23:20.931444Z"},"links":{"cited_paper":"/paper/1707.06347","citing_paper":"/paper/2508.13070"},"observation_digest":"sha256:fa400b02575a9f949ad5d170c069d2360f58508268e0386bd6abcd1c5fe38425","observation_id":"af1b85f7-8cc2-437b-b162-a22ae9d4dfd7","resolution":{"observed_at":"2026-08-15T17:23:20.931444Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T17:23:21.646311Z","title":"Lee, Kangwook Lee, and Dimitris Papailiopoulos","venue":null,"work_id":"0c16ab7e-4e0c-4b61-8390-76cd3bfb0667","year":2024},"citing_paper":{"arxiv_id":"2508.13070","last_updated":"2025-08-18T16:42:55Z","snapshot_observed_at":"2026-08-15T17:13:41.025960Z","submitted_at":"2025-08-18T16:42:55Z","title":"Reinforced Context Order Recovery for Adaptive Reasoning and Planning","version":1},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-08-15T17:23:20.936418Z"},"links":{"citing_paper":"/paper/2508.13070"},"observation_digest":"sha256:9547b3e6352225dbe6ad128b6aa40e9a1a4fa10e5e667493061156ef83f49cec","observation_id":"e29a70e9-5aa6-44de-869d-cde724d26a9b","resolution":{"observed_at":"2026-08-15T17:23:21.650947Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2311.14737","last_updated":"2023-11-22T00:31:01Z","snapshot_observed_at":"2026-08-16T14:41:19.949467Z","submitted_at":"2023-11-22T00:31:01Z","title":"Positional Description Matters for Transformers Arithmetic","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2311.14737","snapshot_observed_at":"2026-08-15T17:23:20.940431Z","title":"Positional description matters for transformers arithmetic","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2508.13070","last_updated":"2025-08-18T16:42:55Z","snapshot_observed_at":"2026-08-15T17:13:41.025960Z","submitted_at":"2025-08-18T16:42:55Z","title":"Reinforced Context Order Recovery for Adaptive Reasoning and Planning","version":1},"reference_index":36,"source":"pdf_text","source_observed_at":"2026-08-15T17:23:20.940431Z"},"links":{"cited_paper":"/paper/2311.14737","citing_paper":"/paper/2508.13070"},"observation_digest":"sha256:746becc1bc28fa3090757e0921045ce043cb9d425d8318bbb76468c31043172a","observation_id":"84f0489b-cafb-4187-8ced-3fe79644a78e","resolution":{"observed_at":"2026-08-15T17:23:20.940431Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2403.05845","last_updated":"2024-03-09T09:04:53Z","snapshot_observed_at":"2026-08-16T14:11:24.373924Z","submitted_at":"2024-03-09T09:04:53Z","title":"Reverse That Number! Decoding Order Matters in Arithmetic Learning","version":1},"cited_work":{"arxiv_id":"2403.05845","doi":null,"metadata_source":"pith","pith_arxiv_id":"2403.05845","snapshot_observed_at":"2026-08-15T17:23:21.140644Z","title":"Reverse That Number! Decoding Order Matters in Arithmetic Learning","venue":"cs.CL","work_id":"264bbd41-0210-4b9a-aa26-c6769ef6faf1","year":2024},"citing_paper":{"arxiv_id":"2508.13070","last_updated":"2025-08-18T16:42:55Z","snapshot_observed_at":"2026-08-15T17:13:41.025960Z","submitted_at":"2025-08-18T16:42:55Z","title":"Reinforced Context Order Recovery for Adaptive Reasoning and Planning","version":1},"reference_index":37,"source":"pdf_text","source_observed_at":"2026-08-15T17:23:21.046550Z"},"links":{"cited_paper":"/paper/2403.05845","citing_paper":"/paper/2508.13070"},"observation_digest":"sha256:e7d2ac256c6712232cd9da30be037563addb44d514bb126b304b844abfa5a4f6","observation_id":"8d965c38-77da-454e-8428-b4256bb5d65f","resolution":{"observed_at":"2026-08-15T17:23:21.195217Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T17:23:21.630441Z","title":"Transformers can do arithmetic with the right embeddings","venue":null,"work_id":"ebc67ee7-dc1d-4d78-aaa1-cacd038f0a49","year":2024},"citing_paper":{"arxiv_id":"2508.13070","last_updated":"2025-08-18T16:42:55Z","snapshot_observed_at":"2026-08-15T17:13:41.025960Z","submitted_at":"2025-08-18T16:42:55Z","title":"Reinforced Context Order Recovery for Adaptive Reasoning and Planning","version":1},"reference_index":38,"source":"pdf_text","source_observed_at":"2026-08-15T17:23:21.073895Z"},"links":{"citing_paper":"/paper/2508.13070"},"observation_digest":"sha256:40e95f075ec391c22b372cfba23ca431d096d2f6ed6c454e43392a81a9c98157","observation_id":"2d4ad7ce-dee2-41de-add0-9c8c7bb0538a","resolution":{"observed_at":"2026-08-15T17:23:21.636104Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2006.14171","last_updated":"2022-05-31T01:58:03Z","snapshot_observed_at":"2026-08-12T19:58:15.318249Z","submitted_at":"2020-06-25T04:47:09Z","title":"A Closer Look at Invalid Action Masking in Policy Gradient Algorithms","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2006.14171","snapshot_observed_at":"2026-08-15T17:23:21.079193Z","title":"A closer look at invalid action masking in policy gradient algorithms","venue":null,"work_id":null,"year":2006},"citing_paper":{"arxiv_id":"2508.13070","last_updated":"2025-08-18T16:42:55Z","snapshot_observed_at":"2026-08-15T17:13:41.025960Z","submitted_at":"2025-08-18T16:42:55Z","title":"Reinforced Context Order Recovery for Adaptive Reasoning and Planning","version":1},"reference_index":39,"source":"pdf_text","source_observed_at":"2026-08-15T17:23:21.079193Z"},"links":{"cited_paper":"/paper/2006.14171","citing_paper":"/paper/2508.13070"},"observation_digest":"sha256:7d0c0f5a30106abba7eeb6405c4aae8e99c00c4828d8b4f1dd175019f7cbfb4e","observation_id":"5f748538-feec-4615-9928-e9c37290ccb1","resolution":{"observed_at":"2026-08-15T17:23:21.079193Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T17:23:21.582212Z","title":"Focal loss for dense object detection","venue":null,"work_id":"2ee8135b-a021-40f8-ad1f-7d08346bad13","year":2017},"citing_paper":{"arxiv_id":"2508.13070","last_updated":"2025-08-18T16:42:55Z","snapshot_observed_at":"2026-08-15T17:13:41.025960Z","submitted_at":"2025-08-18T16:42:55Z","title":"Reinforced Context Order Recovery for Adaptive Reasoning and Planning","version":1},"reference_index":40,"source":"pdf_text","source_observed_at":"2026-08-15T17:23:21.085081Z"},"links":{"citing_paper":"/paper/2508.13070"},"observation_digest":"sha256:90151596cc4f8e46c9cb6b6f7e4f1cdeaa629a19c6bd860729f71b283e48b0cd","observation_id":"0b5c6b90-a96b-41d2-91ab-c5a11eb91d7b","resolution":{"observed_at":"2026-08-15T17:23:21.618707Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}}],"paper":{"arxiv_id":"2508.13070","last_updated":"2025-08-18T16:42:55Z","latest_version":1,"primary_category":"cs.CL","snapshot_observed_at":"2026-08-15T17:13:41.025960Z","submitted_at":"2025-08-18T16:42:55Z","title":"Reinforced Context Order Recovery for Adaptive Reasoning and Planning"},"reference_resolution":{"displayed":40,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":26,"verified_exact":2,"verified_fuzzy":12},"total_outbound_references":40},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"thesis":"As of 18 August 2026, this Paper Citation Record lists 40 of 40 outbound references and 2 inbound Pith citation observations for arXiv:2508.13070."}