{"as_of":"2026-08-15T19:16:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:e87307425823f556d862ae5517d155d947882c4b9d59d30c9cbe9ceb788db31d","coverage":[{"denominator":0,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":6,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":6,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-15T06:32:42.880941+00:00","state":"measured"},{"denominator":6,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":6,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-08T15:45:06.686947Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"arxiv_reference","source_observed_at":"2026-06-29T16:23:39.723318Z","state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2301.03044","last_updated":"2023-09-20T21:12:31Z","snapshot_observed_at":"2026-08-14T02:41:02.417181Z","submitted_at":"2023-01-08T14:04:26Z","title":"A Survey on Transformers in Reinforcement Learning","version":3},"cited_work":{"arxiv_id":"2301.03044","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2301.03044","snapshot_observed_at":"2026-06-29T16:23:39.723318Z","title":"A survey on trans- formers in reinforcement learning","venue":null,"work_id":"11b791e0-1cc2-4325-8f99-910476e40766","year":2023},"citing_paper":{"arxiv_id":"2406.11452","last_updated":"2024-06-17T12:09:11Z","snapshot_observed_at":"2026-08-15T03:57:45.663550Z","submitted_at":"2024-06-17T12:09:11Z","title":"Attention-Based Deep Reinforcement Learning for Qubit Allocation in Modular Quantum Architectures","version":1},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-05-24T00:04:27.182687Z"},"links":{"cited_paper":"/paper/2301.03044","citing_paper":"/paper/2406.11452"},"observation_digest":"sha256:ed32856960f0ef20262154c9135ac93c28d0b61011b212559a38eb919666a8f5","observation_id":"5e830ed3-05f7-46a7-94de-7c13c3a107a4","resolution":{"observed_at":"2026-05-24T00:05:52.975075Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2301.03044","last_updated":"2023-09-20T21:12:31Z","snapshot_observed_at":"2026-08-14T02:41:02.417181Z","submitted_at":"2023-01-08T14:04:26Z","title":"A Survey on Transformers in Reinforcement Learning","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2301.03044","snapshot_observed_at":"2026-08-08T15:45:06.686947Z","title":"arXiv preprint arXiv:2301.03044 (2023)","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2502.06358","last_updated":"2025-07-18T08:29:35Z","snapshot_observed_at":"2026-08-13T10:01:37.197744Z","submitted_at":"2025-02-10T11:20:10Z","title":"Prompt-Tuning Bandits: Enabling Few-Shot Generalization for Efficient Multi-Task Offline RL","version":3},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-08T15:45:06.686947Z"},"links":{"cited_paper":"/paper/2301.03044","citing_paper":"/paper/2502.06358"},"observation_digest":"sha256:e6b6b4eaf0502f511d7bd20da8ed552210f8b0b078f32b638034116f94959d2f","observation_id":"69076c5d-e0ee-4c73-9c58-e81c39d8c0ab","resolution":{"observed_at":"2026-08-08T15:45:06.686947Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2301.03044","last_updated":"2023-09-20T21:12:31Z","snapshot_observed_at":"2026-08-14T02:41:02.417181Z","submitted_at":"2023-01-08T14:04:26Z","title":"A Survey on Transformers in Reinforcement Learning","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2301.03044","snapshot_observed_at":"2026-08-06T15:24:26.139099Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2507.16864","last_updated":"2025-07-21T21:59:05Z","snapshot_observed_at":"2026-08-14T02:35:04.574320Z","submitted_at":"2025-07-21T21:59:05Z","title":"Reinforcement Learning in hyperbolic space for multi-step reasoning","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-06T15:24:26.139099Z"},"links":{"cited_paper":"/paper/2301.03044","citing_paper":"/paper/2507.16864"},"observation_digest":"sha256:6dcf3b6d209a430b5d85bd16614925c4ce6f70c3a3e2f262b416b916531b13c1","observation_id":"5700f723-f5e9-4840-b5d7-8340f3c30fef","resolution":{"observed_at":"2026-08-06T15:24:26.139099Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2301.03044","last_updated":"2023-09-20T21:12:31Z","snapshot_observed_at":"2026-08-14T02:41:02.417181Z","submitted_at":"2023-01-08T14:04:26Z","title":"A Survey on Transformers in Reinforcement Learning","version":3},"cited_work":{"arxiv_id":"2301.03044","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2301.03044","snapshot_observed_at":"2026-06-29T16:23:39.723318Z","title":"A survey on trans- formers in reinforcement learning","venue":null,"work_id":"11b791e0-1cc2-4325-8f99-910476e40766","year":2023},"citing_paper":{"arxiv_id":"2605.00347","last_updated":"2026-05-01T02:05:56Z","snapshot_observed_at":"2026-08-11T00:38:42.624588Z","submitted_at":"2026-05-01T02:05:56Z","title":"Odysseus: Scaling VLMs to 100+ Turn Decision-Making in Games via Reinforcement Learning","version":1},"reference_index":71,"source":"arxiv_source","source_observed_at":"2026-05-09T20:22:58.061772Z"},"links":{"cited_paper":"/paper/2301.03044","citing_paper":"/paper/2605.00347"},"observation_digest":"sha256:abe1fbbe93c0a6d10b98617d7bd766732f782d0bea0192947a174a616822833d","observation_id":"191a9673-57c7-434c-94f7-645f5ba200b0","resolution":{"observed_at":"2026-05-11T15:16:09.320345Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2301.03044","last_updated":"2023-09-20T21:12:31Z","snapshot_observed_at":"2026-08-14T02:41:02.417181Z","submitted_at":"2023-01-08T14:04:26Z","title":"A Survey on Transformers in Reinforcement Learning","version":3},"cited_work":{"arxiv_id":"2301.03044","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2301.03044","snapshot_observed_at":"2026-06-29T16:23:39.723318Z","title":"A survey on trans- formers in reinforcement learning","venue":null,"work_id":"11b791e0-1cc2-4325-8f99-910476e40766","year":2023},"citing_paper":{"arxiv_id":"2606.05208","last_updated":"2026-05-26T06:44:07Z","snapshot_observed_at":"2026-07-06T23:45:11.627867Z","submitted_at":"2026-05-26T06:44:07Z","title":"Transformer-Enhanced Reinforcement Learning: Fundamentals and Applications in Communication Networks","version":1},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-06-29T16:14:25.741686Z"},"links":{"cited_paper":"/paper/2301.03044","citing_paper":"/paper/2606.05208"},"observation_digest":"sha256:cb220477d57aedee131ece58caeccf5e414a3e43da685562beaccbf32ded7f13","observation_id":"0ff01b6a-2f5f-4d95-aa4f-2abd7c9efed6","resolution":{"observed_at":"2026-06-29T16:23:39.724737Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2301.03044","last_updated":"2023-09-20T21:12:31Z","snapshot_observed_at":"2026-08-14T02:41:02.417181Z","submitted_at":"2023-01-08T14:04:26Z","title":"A Survey on Transformers in Reinforcement Learning","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2301.03044","snapshot_observed_at":"2026-08-07T00:25:19.399786Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2608.04421","last_updated":"2026-08-05T04:04:07Z","snapshot_observed_at":"2026-08-15T18:45:14.045401Z","submitted_at":"2026-08-05T04:04:07Z","title":"Generative Optimization for Incentivized Advertising with Global Level Constraints","version":1},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-07T00:25:19.399786Z"},"links":{"cited_paper":"/paper/2301.03044","citing_paper":"/paper/2608.04421"},"observation_digest":"sha256:5f1dc44c9ac9c2b43d0c71747d64894876acab4f0a6f00e5459d2a63370065b2","observation_id":"ab759545-ffc9-4d43-b671-a9df39d227d7","resolution":{"observed_at":"2026-08-07T00:25:19.399786Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"links":{"evidence":"/evidence","html":"/paper/2301.03044/citation-record","integrity":"/paper/2301.03044/integrity","json":"/paper/2301.03044/citation-record.json","paper":"/paper/2301.03044"},"outbound":[],"paper":{"arxiv_id":"2301.03044","last_updated":"2023-09-20T21:12:31Z","latest_version":3,"primary_category":"cs.LG","snapshot_observed_at":"2026-08-14T02:41:02.417181Z","submitted_at":"2023-01-08T14:04:26Z","title":"A Survey on Transformers in Reinforcement Learning"},"reference_resolution":{"displayed":0,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":0,"verified_exact":0,"verified_fuzzy":0},"total_outbound_references":0},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"thesis":"As of 15 August 2026, this Paper Citation Record lists 0 of 0 outbound references and 6 inbound Pith citation observations for arXiv:2301.03044."}