{"as_of":"2026-08-10T11:00:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:5caac779533b5608f0959539d587f92bac486dc04fbccff2af549a40a9faea00","coverage":[{"denominator":0,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":6,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":6,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-10T06:31:04.303077+00:00","state":"measured"},{"denominator":6,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":6,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-07T00:15:15.885559Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"arxiv_reference","source_observed_at":"2026-07-02T07:16:44.965693Z","state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2411.14251","last_updated":"2025-05-28T00:04:45Z","snapshot_observed_at":"2026-07-06T19:53:52.079055Z","submitted_at":"2024-11-21T15:57:02Z","title":"Natural Language Reinforcement Learning","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2411.14251","snapshot_observed_at":"2026-08-06T18:17:51.412053Z","title":"Koushik, Zhiyuan Hu, Ying Wen, and Jun Wang","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.08705","last_updated":"2025-07-11T16:02:24Z","snapshot_observed_at":"2026-08-07T06:05:32.789960Z","submitted_at":"2025-07-11T16:02:24Z","title":"elsciRL: Integrating Language Solutions into Reinforcement Learning Problem Settings","version":1},"reference_index":5,"source":"arxiv_source","source_observed_at":"2026-08-06T18:17:51.412053Z"},"links":{"cited_paper":"/paper/2411.14251","citing_paper":"/paper/2507.08705"},"observation_digest":"sha256:bf406c3ab7013ae34e2ccf3de409e6b02a909989ddcef4ac32d49fbbe7c5727e","observation_id":"1d0bc4b8-304c-47b1-b80c-88712380399e","resolution":{"observed_at":"2026-08-06T18:17:51.412053Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2411.14251","last_updated":"2025-05-28T00:04:45Z","snapshot_observed_at":"2026-07-06T19:53:52.079055Z","submitted_at":"2024-11-21T15:57:02Z","title":"Natural Language Reinforcement Learning","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2411.14251","snapshot_observed_at":"2026-08-06T15:28:42.368027Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.15815","last_updated":"2025-07-21T17:21:14Z","snapshot_observed_at":"2026-08-07T09:07:30.265550Z","submitted_at":"2025-07-21T17:21:14Z","title":"LLM Economist: Large Population Models and Mechanism Design in Multi-Agent Generative Simulacra","version":1},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-06T15:28:42.368027Z"},"links":{"cited_paper":"/paper/2411.14251","citing_paper":"/paper/2507.15815"},"observation_digest":"sha256:eb7bcdda85ced9b54562e0b120417ea62c5dfc5217b2538e51cb7b5a1d36759c","observation_id":"6c032603-e570-4a06-8d29-73791bff4a0d","resolution":{"observed_at":"2026-08-06T15:28:42.368027Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2411.14251","last_updated":"2025-05-28T00:04:45Z","snapshot_observed_at":"2026-07-06T19:53:52.079055Z","submitted_at":"2024-11-21T15:57:02Z","title":"Natural Language Reinforcement Learning","version":3},"cited_work":{"arxiv_id":"2411.14251","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2411.14251","snapshot_observed_at":"2026-07-02T07:16:44.965693Z","title":"Natural language reinforcement learning","venue":null,"work_id":"4915fedb-073b-4f6d-9042-f037a8d99e97","year":2024},"citing_paper":{"arxiv_id":"2605.15113","last_updated":"2026-05-18T19:19:17Z","snapshot_observed_at":"2026-07-06T23:26:28.006734Z","submitted_at":"2026-05-14T17:27:34Z","title":"Learning from Language Feedback via Variational Policy Distillation","version":2},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-05-20T20:34:36.764090Z"},"links":{"cited_paper":"/paper/2411.14251","citing_paper":"/paper/2605.15113"},"observation_digest":"sha256:7fad8694fe5c5e428fa481e3f57fc2324d56ff970c1f76b5c4e72b4365cd3760","observation_id":"a793711b-2543-4159-9e11-a314f0d7daa6","resolution":{"observed_at":"2026-05-20T20:39:00.368600Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2411.14251","last_updated":"2025-05-28T00:04:45Z","snapshot_observed_at":"2026-07-06T19:53:52.079055Z","submitted_at":"2024-11-21T15:57:02Z","title":"Natural Language Reinforcement Learning","version":3},"cited_work":{"arxiv_id":"2411.14251","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2411.14251","snapshot_observed_at":"2026-07-02T07:16:44.965693Z","title":"Natural language reinforcement learning","venue":null,"work_id":"4915fedb-073b-4f6d-9042-f037a8d99e97","year":2024},"citing_paper":{"arxiv_id":"2606.04389","last_updated":"2026-06-03T03:09:10Z","snapshot_observed_at":"2026-08-08T15:47:46.640901Z","submitted_at":"2026-06-03T03:09:10Z","title":"When Clients Stop Following: A Cognitive Conceptualization Diagram-driven Framework for Strategic Counseling","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-06-28T07:01:20.272455Z"},"links":{"cited_paper":"/paper/2411.14251","citing_paper":"/paper/2606.04389"},"observation_digest":"sha256:39a08a75309b4c46afad044fe4dc7e44c1da288ab7426db53224625b2aa7d4e5","observation_id":"62af02a2-3793-4ca9-9930-1bf60acf34a8","resolution":{"observed_at":"2026-07-02T07:16:44.967417Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2411.14251","last_updated":"2025-05-28T00:04:45Z","snapshot_observed_at":"2026-07-06T19:53:52.079055Z","submitted_at":"2024-11-21T15:57:02Z","title":"Natural Language Reinforcement Learning","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2411.14251","snapshot_observed_at":"2026-08-04T15:25:49.260514Z","title":"and Hu, Zhiyuan and Yang, Mengyue and Wen, Ying and Wang, Jun , month = may, year =","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.02087","last_updated":"2026-08-05T10:09:59Z","snapshot_observed_at":"2026-08-09T10:48:15.589859Z","submitted_at":"2026-08-03T11:47:52Z","title":"Instruction-Conditioned Exploration for Reinforcement Learning with Self-Distillation to an Unconditioned Policy","version":1},"reference_index":13,"source":"arxiv_source","source_observed_at":"2026-08-04T15:25:49.260514Z"},"links":{"cited_paper":"/paper/2411.14251","citing_paper":"/paper/2608.02087"},"observation_digest":"sha256:76c391759a54114a77fa6e56bb550b3319a728b63a7e983ac5524ab87529d196","observation_id":"0a90098d-cd39-4f92-a217-89194b133d30","resolution":{"observed_at":"2026-08-04T15:25:49.260514Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2411.14251","last_updated":"2025-05-28T00:04:45Z","snapshot_observed_at":"2026-07-06T19:53:52.079055Z","submitted_at":"2024-11-21T15:57:02Z","title":"Natural Language Reinforcement Learning","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2411.14251","snapshot_observed_at":"2026-08-07T00:15:15.885559Z","title":"and Hu, Zhiyuan and Yang, Mengyue and Wen, Ying and Wang, Jun , month = may, year =","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.02087","last_updated":"2026-08-05T10:09:59Z","snapshot_observed_at":"2026-08-09T10:48:15.589859Z","submitted_at":"2026-08-03T11:47:52Z","title":"Instruction-Conditioned Exploration for Reinforcement Learning with Self-Distillation to an Unconditioned Policy","version":2},"reference_index":13,"source":"arxiv_source","source_observed_at":"2026-08-07T00:15:15.885559Z"},"links":{"cited_paper":"/paper/2411.14251","citing_paper":"/paper/2608.02087"},"observation_digest":"sha256:c20c00fbeda27673a06b860845f37b5e1b43c2f56c3ce24ba901bd18cc0a4804","observation_id":"9be8e652-2fb8-4dc0-ad9b-9062167e5bbf","resolution":{"observed_at":"2026-08-07T00:15:15.885559Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"links":{"evidence":"/evidence","html":"/paper/2411.14251/citation-record","integrity":"/paper/2411.14251/integrity","json":"/paper/2411.14251/citation-record.json","paper":"/paper/2411.14251"},"outbound":[],"paper":{"arxiv_id":"2411.14251","last_updated":"2025-05-28T00:04:45Z","latest_version":3,"primary_category":"cs.LG","snapshot_observed_at":"2026-07-06T19:53:52.079055Z","submitted_at":"2024-11-21T15:57:02Z","title":"Natural Language Reinforcement Learning"},"reference_resolution":{"displayed":0,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":0,"verified_exact":0,"verified_fuzzy":0},"total_outbound_references":0},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"thesis":"As of 10 August 2026, this Paper Citation Record lists 0 of 0 outbound references and 6 inbound Pith citation observations for arXiv:2411.14251."}