{"as_of":"2026-08-10T08:30:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:c96f1a408badff91727b349fbf1b9e530351b6216e88ca246340f1a127e24fea","coverage":[{"denominator":0,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":12,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":12,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-10T06:31:04.303077+00:00","state":"measured"},{"denominator":12,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":12,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-09T22:34:21.362732Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"arxiv_reference","source_observed_at":"2026-07-03T23:39:05.062745Z","state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2310.08566","last_updated":"2024-05-26T04:55:19Z","snapshot_observed_at":"2026-07-06T16:32:07.186600Z","submitted_at":"2023-10-12T17:55:02Z","title":"Transformers as Decision Makers: Provable In-Context Reinforcement Learning via Supervised Pretraining","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2310.08566","snapshot_observed_at":"2026-08-09T22:34:21.362732Z","title":"Transformers as decision makers: Provable in-context reinforcement learning via supervised pretraining, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2501.18793","last_updated":"2025-01-30T22:52:40Z","snapshot_observed_at":"2026-08-10T07:20:03.091929Z","submitted_at":"2025-01-30T22:52:40Z","title":"OT-Transformer: A Continuous-time Transformer Architecture with Optimal Transport Regularization","version":1},"reference_index":37,"source":"arxiv_source","source_observed_at":"2026-08-09T22:34:21.362732Z"},"links":{"cited_paper":"/paper/2310.08566","citing_paper":"/paper/2501.18793"},"observation_digest":"sha256:2aa29e45394653b433336a224d23e7cd03be3800bd37baa2025ed7050a78b0ea","observation_id":"b7f25448-aaed-4adf-8b41-21cbe5c5195f","resolution":{"observed_at":"2026-08-09T22:34:21.362732Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2310.08566","last_updated":"2024-05-26T04:55:19Z","snapshot_observed_at":"2026-07-06T16:32:07.186600Z","submitted_at":"2023-10-12T17:55:02Z","title":"Transformers as Decision Makers: Provable In-Context Reinforcement Learning via Supervised Pretraining","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2310.08566","snapshot_observed_at":"2026-08-09T05:01:32.335815Z","title":"Transformers as decision makers: Provable in-context reinforcement learning via supervised pretraining","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2502.03383","last_updated":"2025-02-05T17:18:55Z","snapshot_observed_at":"2026-08-09T17:48:58.225549Z","submitted_at":"2025-02-05T17:18:55Z","title":"Transformers and Their Roles as Time Series Foundation Models","version":1},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-09T05:01:32.335815Z"},"links":{"cited_paper":"/paper/2310.08566","citing_paper":"/paper/2502.03383"},"observation_digest":"sha256:9c6556903b1c863d1f28c7646edc86f30350feeb5ffbf0206599ca1605b05ba3","observation_id":"253d1545-1299-4b93-9269-aff5e5d781cb","resolution":{"observed_at":"2026-08-09T05:01:32.335815Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2310.08566","last_updated":"2024-05-26T04:55:19Z","snapshot_observed_at":"2026-07-06T16:32:07.186600Z","submitted_at":"2023-10-12T17:55:02Z","title":"Transformers as Decision Makers: Provable In-Context Reinforcement Learning via Supervised Pretraining","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2310.08566","snapshot_observed_at":"2026-08-07T15:27:54.037626Z","title":"Transformers as decision makers: Provable in-context reinforcement learning via supervised pretraining","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.15143","last_updated":"2025-05-21T06:00:41Z","snapshot_observed_at":"2026-08-08T06:05:52.295070Z","submitted_at":"2025-05-21T06:00:41Z","title":"Filtering Learning Histories Enhances In-Context Reinforcement Learning","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-07T15:27:54.037626Z"},"links":{"cited_paper":"/paper/2310.08566","citing_paper":"/paper/2505.15143"},"observation_digest":"sha256:faffd5bd9631b0cdcf52baaefe4e30c0a08334611fa604bdbdb833b1391d8a39","observation_id":"541f0503-2ac9-4743-a858-254dd076fde4","resolution":{"observed_at":"2026-08-07T15:27:54.037626Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2310.08566","last_updated":"2024-05-26T04:55:19Z","snapshot_observed_at":"2026-07-06T16:32:07.186600Z","submitted_at":"2023-10-12T17:55:02Z","title":"Transformers as Decision Makers: Provable In-Context Reinforcement Learning via Supervised Pretraining","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2310.08566","snapshot_observed_at":"2026-08-07T11:40:56.046409Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.01919","last_updated":"2025-06-02T17:39:31Z","snapshot_observed_at":"2026-08-08T16:13:33.864148Z","submitted_at":"2025-06-02T17:39:31Z","title":"Transformers as Multi-task Learners: Decoupling Features in Hidden Markov Models","version":1},"reference_index":22,"source":"arxiv_source","source_observed_at":"2026-08-07T11:40:56.046409Z"},"links":{"cited_paper":"/paper/2310.08566","citing_paper":"/paper/2506.01919"},"observation_digest":"sha256:f4b55814b288970104dbfc289173f4ab14ae5d0bf5970b512ad4b5db6cb15d3b","observation_id":"50c28daa-a967-4087-85c5-2fc111ff7716","resolution":{"observed_at":"2026-08-07T11:40:56.046409Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2310.08566","last_updated":"2024-05-26T04:55:19Z","snapshot_observed_at":"2026-07-06T16:32:07.186600Z","submitted_at":"2023-10-12T17:55:02Z","title":"Transformers as Decision Makers: Provable In-Context Reinforcement Learning via Supervised Pretraining","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2310.08566","snapshot_observed_at":"2026-08-07T10:35:36.202620Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.05295","last_updated":"2025-06-12T16:25:06Z","snapshot_observed_at":"2026-08-09T19:56:00.688282Z","submitted_at":"2025-06-05T17:48:19Z","title":"Sample Complexity and Representation Ability of Test-time Scaling Paradigms","version":2},"reference_index":55,"source":"pdf_text","source_observed_at":"2026-08-07T10:35:36.202620Z"},"links":{"cited_paper":"/paper/2310.08566","citing_paper":"/paper/2506.05295"},"observation_digest":"sha256:fb3be2c8b0767c48a31f9168c11e63a44644caa53ff27a15804d30e7df8c4c9e","observation_id":"c84e3eb6-9af2-4682-a82d-4f7318704b19","resolution":{"observed_at":"2026-08-07T10:35:36.202620Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2310.08566","last_updated":"2024-05-26T04:55:19Z","snapshot_observed_at":"2026-07-06T16:32:07.186600Z","submitted_at":"2023-10-12T17:55:02Z","title":"Transformers as Decision Makers: Provable In-Context Reinforcement Learning via Supervised Pretraining","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2310.08566","snapshot_observed_at":"2026-08-06T15:30:40.997628Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.15759","last_updated":"2025-07-21T16:15:18Z","snapshot_observed_at":"2026-08-07T12:39:48.882990Z","submitted_at":"2025-07-21T16:15:18Z","title":"Interaction as Intelligence: Deep Research With Human-AI Partnership","version":1},"reference_index":48,"source":"arxiv_source","source_observed_at":"2026-08-06T15:30:40.997628Z"},"links":{"cited_paper":"/paper/2310.08566","citing_paper":"/paper/2507.15759"},"observation_digest":"sha256:c15c4576eeae73d708296317359f7915b1da771b517d084015f332f9673f1443","observation_id":"627131a0-eb13-4e91-838c-1ba57d615dbd","resolution":{"observed_at":"2026-08-06T15:30:40.997628Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2310.08566","last_updated":"2024-05-26T04:55:19Z","snapshot_observed_at":"2026-07-06T16:32:07.186600Z","submitted_at":"2023-10-12T17:55:02Z","title":"Transformers as Decision Makers: Provable In-Context Reinforcement Learning via Supervised Pretraining","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2310.08566","snapshot_observed_at":"2026-08-04T09:58:08.178667Z","title":"Transformers as decision makers: Provable in-context reinforcement learning via supervised pretraining","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2510.12624","last_updated":"2026-05-31T20:05:16Z","snapshot_observed_at":"2026-08-08T12:09:35.545752Z","submitted_at":"2025-10-14T15:23:32Z","title":"Learning-To-Measure: In-Context Active Feature Acquisition","version":2},"reference_index":25,"source":"arxiv_source","source_observed_at":"2026-08-04T09:58:08.178667Z"},"links":{"cited_paper":"/paper/2310.08566","citing_paper":"/paper/2510.12624"},"observation_digest":"sha256:4cc057eaff75fccae8a84a55d213be11cb2db8f104fab319536c78cc2392ce6e","observation_id":"8c60488e-d1e0-4a74-9e90-5374a3e4abe7","resolution":{"observed_at":"2026-08-04T09:58:08.178667Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2310.08566","last_updated":"2024-05-26T04:55:19Z","snapshot_observed_at":"2026-07-06T16:32:07.186600Z","submitted_at":"2023-10-12T17:55:02Z","title":"Transformers as Decision Makers: Provable In-Context Reinforcement Learning via Supervised Pretraining","version":2},"cited_work":{"arxiv_id":"2310.08566","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2310.08566","snapshot_observed_at":"2026-07-03T23:39:05.062745Z","title":"org/abs/2310.08566","venue":null,"work_id":"e935c7e1-06b2-4630-8b3b-ef426afd370f","year":2023},"citing_paper":{"arxiv_id":"2605.07959","last_updated":"2026-05-08T16:22:08Z","snapshot_observed_at":"2026-07-06T23:20:15.696237Z","submitted_at":"2026-05-08T16:22:08Z","title":"Convergent Stochastic Training of Attention and Understanding LoRA","version":1},"reference_index":37,"source":"arxiv_source","source_observed_at":"2026-05-11T02:48:35.907351Z"},"links":{"cited_paper":"/paper/2310.08566","citing_paper":"/paper/2605.07959"},"observation_digest":"sha256:d405c44dfd877a5c09579ad17446eb5753df419db4d55d9be2efcd088df5d82d","observation_id":"ebf6068c-72f4-48a4-85fb-f1e9f78abac9","resolution":{"observed_at":"2026-05-11T03:05:55.072521Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2310.08566","last_updated":"2024-05-26T04:55:19Z","snapshot_observed_at":"2026-07-06T16:32:07.186600Z","submitted_at":"2023-10-12T17:55:02Z","title":"Transformers as Decision Makers: Provable In-Context Reinforcement Learning via Supervised Pretraining","version":2},"cited_work":{"arxiv_id":"2310.08566","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2310.08566","snapshot_observed_at":"2026-07-03T23:39:05.062745Z","title":"org/abs/2310.08566","venue":null,"work_id":"e935c7e1-06b2-4630-8b3b-ef426afd370f","year":2023},"citing_paper":{"arxiv_id":"2605.09727","last_updated":"2026-05-10T19:52:29Z","snapshot_observed_at":"2026-07-31T17:23:23.893636Z","submitted_at":"2026-05-10T19:52:29Z","title":"One for All: A Non-Linear Transformer can Enable Cross-Domain Generalization for In-Context Reinforcement Learning","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-05-12T03:46:21.786972Z"},"links":{"cited_paper":"/paper/2310.08566","citing_paper":"/paper/2605.09727"},"observation_digest":"sha256:e6b1e0313d85323e16a26aa1e3eb21764713e0eecaa78d999a1e63e15b72a747","observation_id":"0a4ae872-dfc1-4ca1-8eec-3aa057f95ca3","resolution":{"observed_at":"2026-05-12T06:56:31.956466Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2310.08566","last_updated":"2024-05-26T04:55:19Z","snapshot_observed_at":"2026-07-06T16:32:07.186600Z","submitted_at":"2023-10-12T17:55:02Z","title":"Transformers as Decision Makers: Provable In-Context Reinforcement Learning via Supervised Pretraining","version":2},"cited_work":{"arxiv_id":"2310.08566","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2310.08566","snapshot_observed_at":"2026-07-03T23:39:05.062745Z","title":"org/abs/2310.08566","venue":null,"work_id":"e935c7e1-06b2-4630-8b3b-ef426afd370f","year":2023},"citing_paper":{"arxiv_id":"2605.25210","last_updated":"2026-05-24T18:19:40Z","snapshot_observed_at":"2026-07-31T17:51:56.004972Z","submitted_at":"2026-05-24T18:19:40Z","title":"Multi-Objective Learning for Diffusion Models: A Statistical Theory under Semi-Supervised Learning","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-06-30T12:09:27.409746Z"},"links":{"cited_paper":"/paper/2310.08566","citing_paper":"/paper/2605.25210"},"observation_digest":"sha256:f4c1766d4e0b964190edc2eb83140168dbc3f51ceba7d6f9c78cce70c35afe7a","observation_id":"a545a2ba-50f9-4a1c-a6b9-1a5908caabdd","resolution":{"observed_at":"2026-06-30T12:34:39.412832Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2310.08566","last_updated":"2024-05-26T04:55:19Z","snapshot_observed_at":"2026-07-06T16:32:07.186600Z","submitted_at":"2023-10-12T17:55:02Z","title":"Transformers as Decision Makers: Provable In-Context Reinforcement Learning via Supervised Pretraining","version":2},"cited_work":{"arxiv_id":"2310.08566","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2310.08566","snapshot_observed_at":"2026-07-03T23:39:05.062745Z","title":"org/abs/2310.08566","venue":null,"work_id":"e935c7e1-06b2-4630-8b3b-ef426afd370f","year":2023},"citing_paper":{"arxiv_id":"2606.18812","last_updated":"2026-06-18T16:24:52Z","snapshot_observed_at":"2026-08-09T01:47:10.681363Z","submitted_at":"2026-06-17T08:27:27Z","title":"Reinforcement Learning Foundation Models Should Already Be A Thing","version":2},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-06-26T21:50:00.974590Z"},"links":{"cited_paper":"/paper/2310.08566","citing_paper":"/paper/2606.18812"},"observation_digest":"sha256:d3a140d8a5236269a0592957472ddc4a46bd2b920217a917bd845dc89b2b96d9","observation_id":"cb66579a-6707-412b-a64f-bb9f26450594","resolution":{"observed_at":"2026-07-03T23:39:05.065765Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2310.08566","last_updated":"2024-05-26T04:55:19Z","snapshot_observed_at":"2026-07-06T16:32:07.186600Z","submitted_at":"2023-10-12T17:55:02Z","title":"Transformers as Decision Makers: Provable In-Context Reinforcement Learning via Supervised Pretraining","version":2},"cited_work":{"arxiv_id":"2310.08566","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2310.08566","snapshot_observed_at":"2026-07-03T23:39:05.062745Z","title":"org/abs/2310.08566","venue":null,"work_id":"e935c7e1-06b2-4630-8b3b-ef426afd370f","year":2023},"citing_paper":{"arxiv_id":"2606.31184","last_updated":"2026-06-30T06:13:38Z","snapshot_observed_at":"2026-08-09T06:03:58.665348Z","submitted_at":"2026-06-30T06:13:38Z","title":"Transformers as Bayesian In-Context Experimenters: Smoothness-Adaptive Efficient ATE Estimation","version":1},"reference_index":18,"source":"arxiv_source","source_observed_at":"2026-07-01T06:44:18.631601Z"},"links":{"cited_paper":"/paper/2310.08566","citing_paper":"/paper/2606.31184"},"observation_digest":"sha256:5edc31c32f715b352366b26f2e99ceb2842bf926587ea2e36f415eb7f29abe72","observation_id":"04ef0b51-afca-40b5-b359-5390aa85266e","resolution":{"observed_at":"2026-07-01T06:45:29.285229Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}}],"links":{"evidence":"/evidence","html":"/paper/2310.08566/citation-record","integrity":"/paper/2310.08566/integrity","json":"/paper/2310.08566/citation-record.json","paper":"/paper/2310.08566"},"outbound":[],"paper":{"arxiv_id":"2310.08566","last_updated":"2024-05-26T04:55:19Z","latest_version":2,"primary_category":"cs.LG","snapshot_observed_at":"2026-07-06T16:32:07.186600Z","submitted_at":"2023-10-12T17:55:02Z","title":"Transformers as Decision Makers: Provable In-Context Reinforcement Learning via Supervised Pretraining"},"reference_resolution":{"displayed":0,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":0,"verified_exact":0,"verified_fuzzy":0},"total_outbound_references":0},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"thesis":"As of 10 August 2026, this Paper Citation Record lists 0 of 0 outbound references and 12 inbound Pith citation observations for arXiv:2310.08566."}