{"as_of":"2026-08-20T06:19:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:d212ff51aad310a7c5a8d735c0363ef387e487c74ed80eec2ac17ddcee6ef591","coverage":[{"denominator":0,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":9,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":9,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-19T06:32:44.657259+00:00","state":"measured"},{"denominator":9,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":9,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-15T21:01:22.815814Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"arxiv_reference","source_observed_at":"2026-05-21T00:03:51.932172Z","state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"1910.06764","last_updated":"2019-10-13T20:02:15Z","snapshot_observed_at":"2026-08-15T16:01:17.783695Z","submitted_at":"2019-10-13T20:02:15Z","title":"Stabilizing Transformers for Reinforcement Learning","version":1},"cited_work":{"arxiv_id":"1910.06764","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"1910.06764","snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Stabilizing T ransformers for Re- inforcement Learning","venue":null,"work_id":"93082cee-f9a6-4974-af0d-9e5180d9c059","year":2019},"citing_paper":{"arxiv_id":"2401.10774","last_updated":"2024-06-14T23:32:32Z","snapshot_observed_at":"2026-08-17T10:13:54.763177Z","submitted_at":"2024-01-19T15:48:40Z","title":"Medusa: Simple LLM Inference Acceleration Framework with Multiple Decoding Heads","version":3},"reference_index":226,"source":"arxiv_source","source_observed_at":"2026-05-13T10:36:17.764761Z"},"links":{"cited_paper":"/paper/1910.06764","citing_paper":"/paper/2401.10774"},"observation_digest":"sha256:5877c4668bf724ca9f90700302806fb156dcf4dd9071faf882fc9a6ae6e50d4a","observation_id":"7d366faa-f293-4e19-b567-0636d2d4e3a0","resolution":{"observed_at":"2026-05-13T10:36:18.241286Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1910.06764","last_updated":"2019-10-13T20:02:15Z","snapshot_observed_at":"2026-08-15T16:01:17.783695Z","submitted_at":"2019-10-13T20:02:15Z","title":"Stabilizing Transformers for Reinforcement Learning","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1910.06764","snapshot_observed_at":"2026-08-15T21:01:22.815814Z","title":"Stabilizing transformers for reinforcement learning,","venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2505.11153","last_updated":"2025-05-16T11:54:48Z","snapshot_observed_at":"2026-08-19T02:52:55.887651Z","submitted_at":"2025-05-16T11:54:48Z","title":"Bi-directional Recurrence Improves Transformer in Partially Observable Markov Decision Processes","version":1},"reference_index":50,"source":"pdf_text","source_observed_at":"2026-08-15T21:01:22.815814Z"},"links":{"cited_paper":"/paper/1910.06764","citing_paper":"/paper/2505.11153"},"observation_digest":"sha256:992173c3e7ff1adae12cf90822547dff43000ab4277ae9d6186209065f14227f","observation_id":"1e28d407-380d-484e-9aca-ba9d95119dfe","resolution":{"observed_at":"2026-08-15T21:01:22.815814Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1910.06764","last_updated":"2019-10-13T20:02:15Z","snapshot_observed_at":"2026-08-15T16:01:17.783695Z","submitted_at":"2019-10-13T20:02:15Z","title":"Stabilizing Transformers for Reinforcement Learning","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1910.06764","snapshot_observed_at":"2026-08-07T04:57:25.771086Z","title":"Stabilizing transformers for reinforcement learning,","venue":null,"work_id":null,"year":1910},"citing_paper":{"arxiv_id":"2506.09331","last_updated":"2025-06-17T23:22:53Z","snapshot_observed_at":"2026-08-20T02:16:16.366639Z","submitted_at":"2025-06-11T02:12:34Z","title":"Multi-Agent Language Models: Advancing Cooperation, Coordination, and Adaptation","version":2},"reference_index":56,"source":"pdf_text","source_observed_at":"2026-08-07T04:57:25.771086Z"},"links":{"cited_paper":"/paper/1910.06764","citing_paper":"/paper/2506.09331"},"observation_digest":"sha256:48741fd1070fcd2ddd9b9ae3f914d4a285785e03ffa7037c58befe7e993d71c8","observation_id":"93dcfc35-282e-4bef-ade6-6496f8ff10df","resolution":{"observed_at":"2026-08-07T04:57:25.771086Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1910.06764","last_updated":"2019-10-13T20:02:15Z","snapshot_observed_at":"2026-08-15T16:01:17.783695Z","submitted_at":"2019-10-13T20:02:15Z","title":"Stabilizing Transformers for Reinforcement Learning","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1910.06764","snapshot_observed_at":"2026-08-15T15:49:22.373877Z","title":"Stabilizing Transformers for Reinforcement Learning,","venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2510.24515","last_updated":"2026-06-10T10:35:57Z","snapshot_observed_at":"2026-08-19T11:38:32.228421Z","submitted_at":"2025-10-28T15:27:26Z","title":"Learning Ordinal Response Policies in Rank-Based Stochastic Prize-Collecting Games","version":2},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-15T15:49:22.373877Z"},"links":{"cited_paper":"/paper/1910.06764","citing_paper":"/paper/2510.24515"},"observation_digest":"sha256:3a09dc8d18680f5d3530457e3ffa723d1529775f008a3a66e48f31390c08de91","observation_id":"cdeba35a-1efa-4ffe-afcd-fa9a50b79ee1","resolution":{"observed_at":"2026-08-15T15:49:22.373877Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1910.06764","last_updated":"2019-10-13T20:02:15Z","snapshot_observed_at":"2026-08-15T16:01:17.783695Z","submitted_at":"2019-10-13T20:02:15Z","title":"Stabilizing Transformers for Reinforcement Learning","version":1},"cited_work":{"arxiv_id":"1910.06764","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"1910.06764","snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Stabilizing T ransformers for Re- inforcement Learning","venue":null,"work_id":"93082cee-f9a6-4974-af0d-9e5180d9c059","year":2019},"citing_paper":{"arxiv_id":"2604.04662","last_updated":"2026-04-06T13:15:44Z","snapshot_observed_at":"2026-08-14T05:46:46.376165Z","submitted_at":"2026-04-06T13:15:44Z","title":"Anticipatory Reinforcement Learning: From Generative Path-Laws to Distributional Value Functions","version":1},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-05-10T19:28:16.659393Z"},"links":{"cited_paper":"/paper/1910.06764","citing_paper":"/paper/2604.04662"},"observation_digest":"sha256:c178f2c538e92ab36dc86da2e990aa66719a901c50d7acb8302bc6c585c53716","observation_id":"8b9d26ea-4635-4fb4-ba2d-cd05c4e34039","resolution":{"observed_at":"2026-05-10T22:55:50.050619Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1910.06764","last_updated":"2019-10-13T20:02:15Z","snapshot_observed_at":"2026-08-15T16:01:17.783695Z","submitted_at":"2019-10-13T20:02:15Z","title":"Stabilizing Transformers for Reinforcement Learning","version":1},"cited_work":{"arxiv_id":"1910.06764","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"1910.06764","snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Stabilizing T ransformers for Re- inforcement Learning","venue":null,"work_id":"93082cee-f9a6-4974-af0d-9e5180d9c059","year":2019},"citing_paper":{"arxiv_id":"2604.09671","last_updated":"2026-04-01T22:28:38Z","snapshot_observed_at":"2026-08-11T19:11:36.669308Z","submitted_at":"2026-04-01T22:28:38Z","title":"Belief-State RWKV for Reinforcement Learning under Partial Observability","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-05-13T21:56:09.642064Z"},"links":{"cited_paper":"/paper/1910.06764","citing_paper":"/paper/2604.09671"},"observation_digest":"sha256:6e7da3f84aaff51559399a9841b88ea4d3ba709198cbdc32de0898e63799c466","observation_id":"ed5b41cd-213d-4b87-a42a-c20a3c594f09","resolution":{"observed_at":"2026-05-13T21:58:19.948012Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1910.06764","last_updated":"2019-10-13T20:02:15Z","snapshot_observed_at":"2026-08-15T16:01:17.783695Z","submitted_at":"2019-10-13T20:02:15Z","title":"Stabilizing Transformers for Reinforcement Learning","version":1},"cited_work":{"arxiv_id":"1910.06764","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"1910.06764","snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Stabilizing T ransformers for Re- inforcement Learning","venue":null,"work_id":"93082cee-f9a6-4974-af0d-9e5180d9c059","year":2019},"citing_paper":{"arxiv_id":"2604.18933","last_updated":"2026-08-03T20:19:45Z","snapshot_observed_at":"2026-08-16T00:57:45.111946Z","submitted_at":"2026-04-21T00:14:50Z","title":"Gated Memory Policy: In-Context Memorization and Adaptation","version":1},"reference_index":39,"source":"pdf_text","source_observed_at":"2026-05-10T03:16:21.448753Z"},"links":{"cited_paper":"/paper/1910.06764","citing_paper":"/paper/2604.18933"},"observation_digest":"sha256:3d4be1d454113f6baebfa98af0b31bfabfb7ac63d8f9b0d2f6d0f6c167603c06","observation_id":"35652a3f-a239-47e6-b1fa-9e6dc9a139e7","resolution":{"observed_at":"2026-05-11T12:41:03.387446Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1910.06764","last_updated":"2019-10-13T20:02:15Z","snapshot_observed_at":"2026-08-15T16:01:17.783695Z","submitted_at":"2019-10-13T20:02:15Z","title":"Stabilizing Transformers for Reinforcement Learning","version":1},"cited_work":{"arxiv_id":"1910.06764","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"1910.06764","snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Stabilizing T ransformers for Re- inforcement Learning","venue":null,"work_id":"93082cee-f9a6-4974-af0d-9e5180d9c059","year":2019},"citing_paper":{"arxiv_id":"2605.02075","last_updated":"2026-05-16T16:12:11Z","snapshot_observed_at":"2026-08-11T13:57:59.373732Z","submitted_at":"2026-05-03T22:26:52Z","title":"Graph Transformers and Stabilized Reinforcement Learning for Large-Scale Dynamic Routing Modulation and Spectrum Allocation in Elastic Optical Networks","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-05-08T18:47:04.091987Z"},"links":{"cited_paper":"/paper/1910.06764","citing_paper":"/paper/2605.02075"},"observation_digest":"sha256:5f56c604de23187053a4d793b77024276842a173fc9d2d1183f17983de583397","observation_id":"7784cf04-b36f-44b1-8b2f-69fbeb97365a","resolution":{"observed_at":"2026-05-09T06:10:43.192778Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1910.06764","last_updated":"2019-10-13T20:02:15Z","snapshot_observed_at":"2026-08-15T16:01:17.783695Z","submitted_at":"2019-10-13T20:02:15Z","title":"Stabilizing Transformers for Reinforcement Learning","version":1},"cited_work":{"arxiv_id":"1910.06764","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"1910.06764","snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Stabilizing T ransformers for Re- inforcement Learning","venue":null,"work_id":"93082cee-f9a6-4974-af0d-9e5180d9c059","year":2019},"citing_paper":{"arxiv_id":"2605.02075","last_updated":"2026-05-16T16:12:11Z","snapshot_observed_at":"2026-08-11T13:57:59.373732Z","submitted_at":"2026-05-03T22:26:52Z","title":"Graph Transformers and Stabilized Reinforcement Learning for Large-Scale Dynamic Routing Modulation and Spectrum Allocation in Elastic Optical Networks","version":2},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-05-21T00:02:01.826213Z"},"links":{"cited_paper":"/paper/1910.06764","citing_paper":"/paper/2605.02075"},"observation_digest":"sha256:5ea045efc12b9a063be9b87de4df91d4b064f5f7b2482b92da48c40dee39d94c","observation_id":"3983e25e-300e-4ca8-84b5-721b3d45cdd0","resolution":{"observed_at":"2026-05-21T00:03:51.939034Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}}],"links":{"evidence":"/evidence","html":"/paper/1910.06764/citation-record","integrity":"/paper/1910.06764/integrity","json":"/paper/1910.06764/citation-record.json","paper":"/paper/1910.06764"},"outbound":[],"paper":{"arxiv_id":"1910.06764","last_updated":"2019-10-13T20:02:15Z","latest_version":1,"primary_category":"cs.LG","snapshot_observed_at":"2026-08-15T16:01:17.783695Z","submitted_at":"2019-10-13T20:02:15Z","title":"Stabilizing Transformers for Reinforcement Learning"},"reference_resolution":{"displayed":0,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":0,"verified_exact":0,"verified_fuzzy":0},"total_outbound_references":0},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"thesis":"As of 20 August 2026, this Paper Citation Record lists 0 of 0 outbound references and 9 inbound Pith citation observations for arXiv:1910.06764."}