{"as_of":"2026-08-09T05:54:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:fd9d7e5ecff80de4d521b0095c0b2a2f56cda0a32f24655f8dff6f6ef5ab09c7","coverage":[{"denominator":21,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":21,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-07T00:54:34.992032Z","state":"measured"},{"denominator":21,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":21,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-08T06:32:00.761636+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2506.12366/citation-record","integrity":"/paper/2506.12366/integrity","json":"/paper/2506.12366/citation-record.json","paper":"/paper/2506.12366"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T00:54:37.791998Z","title":null,"venue":null,"work_id":"ace79500-f13a-460a-893d-64c3c994a834","year":2016},"citing_paper":{"arxiv_id":"2506.12366","last_updated":"2025-06-14T05:56:42Z","snapshot_observed_at":"2026-08-07T00:49:31.675196Z","submitted_at":"2025-06-14T05:56:42Z","title":"Ghost Policies: A New Paradigm for Understanding and Learning from Failure in Deep Reinforcement Learning","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-07T00:54:33.093584Z"},"links":{"citing_paper":"/paper/2506.12366"},"observation_digest":"sha256:05056fdc725ec1439a52c40ebe0938ed315808cd4a60e92b1acd8415d16a3398","observation_id":"ff819525-73b8-41fa-b0f1-209cf67f3208","resolution":{"observed_at":"2026-08-07T00:54:37.850630Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1312.5602","last_updated":"2013-12-19T16:00:08Z","snapshot_observed_at":"2026-07-06T03:31:23.521122Z","submitted_at":"2013-12-19T16:00:08Z","title":"Playing Atari with Deep Reinforcement Learning","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1312.5602","snapshot_observed_at":"2026-08-07T00:54:33.154377Z","title":null,"venue":null,"work_id":null,"year":2013},"citing_paper":{"arxiv_id":"2506.12366","last_updated":"2025-06-14T05:56:42Z","snapshot_observed_at":"2026-08-07T00:49:31.675196Z","submitted_at":"2025-06-14T05:56:42Z","title":"Ghost Policies: A New Paradigm for Understanding and Learning from Failure in Deep Reinforcement Learning","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-07T00:54:33.154377Z"},"links":{"cited_paper":"/paper/1312.5602","citing_paper":"/paper/2506.12366"},"observation_digest":"sha256:b994d4f8c154af07d7573f1a5665402cbadbd77c97094705e9db5c5d95820d01","observation_id":"62341f45-5ae2-4e76-97d0-b1477f3800f1","resolution":{"observed_at":"2026-08-07T00:54:33.154377Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T00:54:37.642690Z","title":null,"venue":null,"work_id":"2cf9eab8-b3d5-48d6-841c-5cdd12564343","year":2019},"citing_paper":{"arxiv_id":"2506.12366","last_updated":"2025-06-14T05:56:42Z","snapshot_observed_at":"2026-08-07T00:49:31.675196Z","submitted_at":"2025-06-14T05:56:42Z","title":"Ghost Policies: A New Paradigm for Understanding and Learning from Failure in Deep Reinforcement Learning","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-07T00:54:33.238890Z"},"links":{"citing_paper":"/paper/2506.12366"},"observation_digest":"sha256:9521c397ac06c5aa36f7850de78647ccfe66f91ce4dc9123a65516f108674726","observation_id":"d9c691f7-9c49-429c-aa7c-8f33f9ce667d","resolution":{"observed_at":"2026-08-07T00:54:37.717508Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1806.10293","last_updated":"2018-11-28T02:40:54Z","snapshot_observed_at":"2026-08-02T20:30:39.614115Z","submitted_at":"2018-06-27T04:34:30Z","title":"QT-Opt: Scalable Deep Reinforcement Learning for Vision-Based Robotic Manipulation","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1806.10293","snapshot_observed_at":"2026-08-07T00:54:33.317628Z","title":null,"venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2506.12366","last_updated":"2025-06-14T05:56:42Z","snapshot_observed_at":"2026-08-07T00:49:31.675196Z","submitted_at":"2025-06-14T05:56:42Z","title":"Ghost Policies: A New Paradigm for Understanding and Learning from Failure in Deep Reinforcement Learning","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-07T00:54:33.317628Z"},"links":{"cited_paper":"/paper/1806.10293","citing_paper":"/paper/2506.12366"},"observation_digest":"sha256:f6990724ab4b523a0f192e1ef557bdde4b987db7c14ae5f659be54a6e8e5297c","observation_id":"bc84f432-7f24-4c6c-bdac-2375dc1ef1b7","resolution":{"observed_at":"2026-08-07T00:54:33.317628Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1910.07113","last_updated":"2019-10-16T00:59:05Z","snapshot_observed_at":"2026-08-02T15:37:37.200292Z","submitted_at":"2019-10-16T00:59:05Z","title":"Solving Rubik's Cube with a Robot Hand","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1910.07113","snapshot_observed_at":"2026-08-07T00:54:33.499519Z","title":null,"venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2506.12366","last_updated":"2025-06-14T05:56:42Z","snapshot_observed_at":"2026-08-07T00:49:31.675196Z","submitted_at":"2025-06-14T05:56:42Z","title":"Ghost Policies: A New Paradigm for Understanding and Learning from Failure in Deep Reinforcement Learning","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-07T00:54:33.499519Z"},"links":{"cited_paper":"/paper/1910.07113","citing_paper":"/paper/2506.12366"},"observation_digest":"sha256:40325085e65f026a90d2292b29c0b90ddd7bcfd2f8db9f3d35512ade76c40f5b","observation_id":"62b23a52-8c10-4b28-8f78-7cf8a2647170","resolution":{"observed_at":"2026-08-07T00:54:33.499519Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2402.03590","last_updated":"2024-02-05T23:50:55Z","snapshot_observed_at":"2026-07-06T17:25:53.950578Z","submitted_at":"2024-02-05T23:50:55Z","title":"Assessing the Impact of Distribution Shift on Reinforcement Learning Performance","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.03590","snapshot_observed_at":"2026-08-07T00:54:33.540733Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.12366","last_updated":"2025-06-14T05:56:42Z","snapshot_observed_at":"2026-08-07T00:49:31.675196Z","submitted_at":"2025-06-14T05:56:42Z","title":"Ghost Policies: A New Paradigm for Understanding and Learning from Failure in Deep Reinforcement Learning","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-07T00:54:33.540733Z"},"links":{"cited_paper":"/paper/2402.03590","citing_paper":"/paper/2506.12366"},"observation_digest":"sha256:ed3931a18cff56281563d99ab7f2fae97895b8fd111400c74376bcb94e639d78","observation_id":"3628204b-3c6f-4f7e-aed3-8e1bc22dc60a","resolution":{"observed_at":"2026-08-07T00:54:33.540733Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T00:54:37.502561Z","title":null,"venue":null,"work_id":"2f7a67d1-746f-42dc-acad-de936d3e2c04","year":2019},"citing_paper":{"arxiv_id":"2506.12366","last_updated":"2025-06-14T05:56:42Z","snapshot_observed_at":"2026-08-07T00:49:31.675196Z","submitted_at":"2025-06-14T05:56:42Z","title":"Ghost Policies: A New Paradigm for Understanding and Learning from Failure in Deep Reinforcement Learning","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-07T00:54:33.636171Z"},"links":{"citing_paper":"/paper/2506.12366"},"observation_digest":"sha256:c95b91a5b67b247527268fc87756bc527538379d08cb866e37aa2383bad10abc","observation_id":"d8067b51-5833-42ea-bdd8-8ddf3eaa0c66","resolution":{"observed_at":"2026-08-07T00:54:37.560428Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2201.03544","last_updated":"2022-02-14T09:05:38Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2022-01-10T18:58:52Z","title":"The Effects of Reward Misspecification: Mapping and Mitigating Misaligned Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2201.03544","snapshot_observed_at":"2026-08-07T00:54:33.681317Z","title":"& Hilton, J","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2506.12366","last_updated":"2025-06-14T05:56:42Z","snapshot_observed_at":"2026-08-07T00:49:31.675196Z","submitted_at":"2025-06-14T05:56:42Z","title":"Ghost Policies: A New Paradigm for Understanding and Learning from Failure in Deep Reinforcement Learning","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-07T00:54:33.681317Z"},"links":{"cited_paper":"/paper/2201.03544","citing_paper":"/paper/2506.12366"},"observation_digest":"sha256:9fa72e5375bf9ecf5c0b494e760af771c549f5cb11008752c48c0d200c3c688f","observation_id":"2f0afb74-432c-4faa-af13-36455bc8470c","resolution":{"observed_at":"2026-08-07T00:54:33.681317Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T00:54:37.307125Z","title":"& Krueger, D","venue":null,"work_id":"e997f0e0-3e3a-4a2b-99a5-3baab562fc40","year":2022},"citing_paper":{"arxiv_id":"2506.12366","last_updated":"2025-06-14T05:56:42Z","snapshot_observed_at":"2026-08-07T00:49:31.675196Z","submitted_at":"2025-06-14T05:56:42Z","title":"Ghost Policies: A New Paradigm for Understanding and Learning from Failure in Deep Reinforcement Learning","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-07T00:54:33.765659Z"},"links":{"citing_paper":"/paper/2506.12366"},"observation_digest":"sha256:5e786a6c6270c327e8c0fbc23b9094e584582c54bb1e1329fa7d9a07ed20d1a9","observation_id":"eae48b2e-276e-42bd-a27d-a3ad041d95a6","resolution":{"observed_at":"2026-08-07T00:54:37.422518Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T00:54:37.132338Z","title":null,"venue":null,"work_id":"3da5d3e7-f604-4fd8-a908-7552c19f6326","year":2015},"citing_paper":{"arxiv_id":"2506.12366","last_updated":"2025-06-14T05:56:42Z","snapshot_observed_at":"2026-08-07T00:49:31.675196Z","submitted_at":"2025-06-14T05:56:42Z","title":"Ghost Policies: A New Paradigm for Understanding and Learning from Failure in Deep Reinforcement Learning","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-07T00:54:33.800807Z"},"links":{"citing_paper":"/paper/2506.12366"},"observation_digest":"sha256:b4fa381c4c91c04de47866f97add38ad286548fbe10e6696f5b4dc4e173a904f","observation_id":"b85e1bf7-f3de-45f9-ab9b-376693f31989","resolution":{"observed_at":"2026-08-07T00:54:37.229349Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T00:54:37.011720Z","title":null,"venue":null,"work_id":"e5376005-5278-40f0-b496-a41c666b0af5","year":2021},"citing_paper":{"arxiv_id":"2506.12366","last_updated":"2025-06-14T05:56:42Z","snapshot_observed_at":"2026-08-07T00:49:31.675196Z","submitted_at":"2025-06-14T05:56:42Z","title":"Ghost Policies: A New Paradigm for Understanding and Learning from Failure in Deep Reinforcement Learning","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-07T00:54:33.812768Z"},"links":{"citing_paper":"/paper/2506.12366"},"observation_digest":"sha256:2459ed264a82c8e808e58b4fdaa28d0f437231088cd4c5e37aeccddce2ba49c3","observation_id":"f4514670-e34f-4f9d-8d03-cc0053e9feb2","resolution":{"observed_at":"2026-08-07T00:54:37.062856Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2312.11118","last_updated":"2023-12-18T11:34:58Z","snapshot_observed_at":"2026-08-07T13:25:08.446354Z","submitted_at":"2023-12-18T11:34:58Z","title":"Explaining Reinforcement Learning Agents Through Counterfactual Action Outcomes","version":1},"cited_work":{"arxiv_id":"2312.11118","doi":null,"metadata_source":"pith","pith_arxiv_id":"2312.11118","snapshot_observed_at":"2026-08-07T00:54:35.167642Z","title":"Explaining Reinforcement Learning Agents Through Counterfactual Action Outcomes","venue":"cs.AI","work_id":"802d9f26-87dd-486e-bd33-e44c864257ab","year":2023},"citing_paper":{"arxiv_id":"2506.12366","last_updated":"2025-06-14T05:56:42Z","snapshot_observed_at":"2026-08-07T00:49:31.675196Z","submitted_at":"2025-06-14T05:56:42Z","title":"Ghost Policies: A New Paradigm for Understanding and Learning from Failure in Deep Reinforcement Learning","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-07T00:54:33.844964Z"},"links":{"cited_paper":"/paper/2312.11118","citing_paper":"/paper/2506.12366"},"observation_digest":"sha256:521404510999e167a033444c7993a7b60f730579f99ef01398cc75356d07eb4f","observation_id":"1b0bfa77-eac1-43fc-8dea-8a54105fb0c4","resolution":{"observed_at":"2026-08-07T00:54:35.277560Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T00:54:36.809417Z","title":"& Fal- cone, F","venue":null,"work_id":"46063508-27ca-478a-a961-daa02c8ae5b0","year":2021},"citing_paper":{"arxiv_id":"2506.12366","last_updated":"2025-06-14T05:56:42Z","snapshot_observed_at":"2026-08-07T00:49:31.675196Z","submitted_at":"2025-06-14T05:56:42Z","title":"Ghost Policies: A New Paradigm for Understanding and Learning from Failure in Deep Reinforcement Learning","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-07T00:54:33.959059Z"},"links":{"citing_paper":"/paper/2506.12366"},"observation_digest":"sha256:37d71106236fbcaac2676fac0959cc7149c0c0de827c31c149ac68fd8eb64330","observation_id":"cae01744-3e5b-4045-b837-214e3d193530","resolution":{"observed_at":"2026-08-07T00:54:36.900260Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T00:54:36.626966Z","title":null,"venue":null,"work_id":"4c16c1a0-84cc-4571-ad2c-61583c3f359c","year":2024},"citing_paper":{"arxiv_id":"2506.12366","last_updated":"2025-06-14T05:56:42Z","snapshot_observed_at":"2026-08-07T00:49:31.675196Z","submitted_at":"2025-06-14T05:56:42Z","title":"Ghost Policies: A New Paradigm for Understanding and Learning from Failure in Deep Reinforcement Learning","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-07T00:54:34.070052Z"},"links":{"citing_paper":"/paper/2506.12366"},"observation_digest":"sha256:93dbd65213ec9fa9b3a82f66c0c90be8127e7429f9a6913bcb61167ac3afba82","observation_id":"4a8df109-521d-4be5-b39c-fc5d20ccc265","resolution":{"observed_at":"2026-08-07T00:54:36.705638Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T00:54:36.482797Z","title":"ARMADA: Augmented Reality for Robot Manipulation and Robot-Free Data Acquisition (2024)","venue":null,"work_id":"174153f4-5280-4545-95af-49036ed29d38","year":2024},"citing_paper":{"arxiv_id":"2506.12366","last_updated":"2025-06-14T05:56:42Z","snapshot_observed_at":"2026-08-07T00:49:31.675196Z","submitted_at":"2025-06-14T05:56:42Z","title":"Ghost Policies: A New Paradigm for Understanding and Learning from Failure in Deep Reinforcement Learning","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-07T00:54:34.202429Z"},"links":{"citing_paper":"/paper/2506.12366"},"observation_digest":"sha256:f28f69be632149e640dc33c4f8abed92c916b391ac3a60249ea3ac73dc28ba94","observation_id":"05b5c852-5616-4152-b1c2-c744954b8c4e","resolution":{"observed_at":"2026-08-07T00:54:36.547757Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T00:54:36.349402Z","title":"Simulated augmented reality and virtual immersive technologies","venue":null,"work_id":"585cea6a-9e6e-4dca-b3c5-a16d7b29a60b","year":2023},"citing_paper":{"arxiv_id":"2506.12366","last_updated":"2025-06-14T05:56:42Z","snapshot_observed_at":"2026-08-07T00:49:31.675196Z","submitted_at":"2025-06-14T05:56:42Z","title":"Ghost Policies: A New Paradigm for Understanding and Learning from Failure in Deep Reinforcement Learning","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-07T00:54:34.334632Z"},"links":{"citing_paper":"/paper/2506.12366"},"observation_digest":"sha256:607090d8e000f82876c13a062912269b74554e1d053cddb3c4011188a45b19cc","observation_id":"24ff9008-bd64-4e78-9ffa-eaa4f21ff008","resolution":{"observed_at":"2026-08-07T00:54:36.419593Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T00:54:36.180934Z","title":"& Yablon, Z","venue":null,"work_id":"cbb24965-6ea1-4230-a767-c726ae9d50d5","year":2023},"citing_paper":{"arxiv_id":"2506.12366","last_updated":"2025-06-14T05:56:42Z","snapshot_observed_at":"2026-08-07T00:49:31.675196Z","submitted_at":"2025-06-14T05:56:42Z","title":"Ghost Policies: A New Paradigm for Understanding and Learning from Failure in Deep Reinforcement Learning","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-07T00:54:34.464284Z"},"links":{"citing_paper":"/paper/2506.12366"},"observation_digest":"sha256:ff43ce5d94f1025cb3d3c07348a41b0ba59ee2e0f20e3fdb81470e79c674ba38","observation_id":"2acbf66a-3a1c-4421-8c16-87365c2f07d0","resolution":{"observed_at":"2026-08-07T00:54:36.257621Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T00:54:35.975705Z","title":"& Luo, X","venue":null,"work_id":"586a93c3-e534-4830-82eb-a74db9b9abd5","year":2023},"citing_paper":{"arxiv_id":"2506.12366","last_updated":"2025-06-14T05:56:42Z","snapshot_observed_at":"2026-08-07T00:49:31.675196Z","submitted_at":"2025-06-14T05:56:42Z","title":"Ghost Policies: A New Paradigm for Understanding and Learning from Failure in Deep Reinforcement Learning","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-07T00:54:34.633125Z"},"links":{"citing_paper":"/paper/2506.12366"},"observation_digest":"sha256:dc061bd2ecb25b79df5002df213d119d9026fac9b8dd2fc13b33d4565a3e609d","observation_id":"60cc0211-e0a1-4795-80a4-b7c81e549c6c","resolution":{"observed_at":"2026-08-07T00:54:36.097045Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T00:54:35.776234Z","title":null,"venue":null,"work_id":"64f66e7d-ff5a-48d8-ac0a-d9c3b56263e6","year":2024},"citing_paper":{"arxiv_id":"2506.12366","last_updated":"2025-06-14T05:56:42Z","snapshot_observed_at":"2026-08-07T00:49:31.675196Z","submitted_at":"2025-06-14T05:56:42Z","title":"Ghost Policies: A New Paradigm for Understanding and Learning from Failure in Deep Reinforcement Learning","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-07T00:54:34.746730Z"},"links":{"citing_paper":"/paper/2506.12366"},"observation_digest":"sha256:394c46365373909f0ec2d9835b945c95c03ca98cab7edaf7a5b7b2f6d008431e","observation_id":"c28be68d-25d9-4e01-bd62-8f058b35881b","resolution":{"observed_at":"2026-08-07T00:54:35.885780Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T00:54:35.533783Z","title":"& Lee, J","venue":null,"work_id":"9099647d-fa4b-4f03-ad7d-42e960b5fdc7","year":2023},"citing_paper":{"arxiv_id":"2506.12366","last_updated":"2025-06-14T05:56:42Z","snapshot_observed_at":"2026-08-07T00:49:31.675196Z","submitted_at":"2025-06-14T05:56:42Z","title":"Ghost Policies: A New Paradigm for Understanding and Learning from Failure in Deep Reinforcement Learning","version":1},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-07T00:54:34.847455Z"},"links":{"citing_paper":"/paper/2506.12366"},"observation_digest":"sha256:de2da10ffe6f80fdbb6561ef1e0085ab91790b986bdf459957baf0a092d9610f","observation_id":"cb1e6732-4b91-4ebf-a565-2c1f2eb8f6a3","resolution":{"observed_at":"2026-08-07T00:54:35.649468Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1809.02627","last_updated":"2020-05-06T17:59:11Z","snapshot_observed_at":"2026-08-08T05:36:49.312180Z","submitted_at":"2018-09-07T18:13:25Z","title":"Unity: A General Platform for Intelligent Agents","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1809.02627","snapshot_observed_at":"2026-08-07T00:54:34.992032Z","title":null,"venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2506.12366","last_updated":"2025-06-14T05:56:42Z","snapshot_observed_at":"2026-08-07T00:49:31.675196Z","submitted_at":"2025-06-14T05:56:42Z","title":"Ghost Policies: A New Paradigm for Understanding and Learning from Failure in Deep Reinforcement Learning","version":1},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-07T00:54:34.992032Z"},"links":{"cited_paper":"/paper/1809.02627","citing_paper":"/paper/2506.12366"},"observation_digest":"sha256:5838cf93863aa8d1367437a3a7de43df3aeeffc157b0d8593ea78134aff6ac83","observation_id":"6735d5a7-b288-4389-a2a1-463332410c9d","resolution":{"observed_at":"2026-08-07T00:54:34.992032Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"paper":{"arxiv_id":"2506.12366","last_updated":"2025-06-14T05:56:42Z","latest_version":1,"primary_category":"cs.AI","snapshot_observed_at":"2026-08-07T00:49:31.675196Z","submitted_at":"2025-06-14T05:56:42Z","title":"Ghost Policies: A New Paradigm for Understanding and Learning from Failure in Deep Reinforcement Learning"},"reference_resolution":{"displayed":21,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":13,"verified_exact":1,"verified_fuzzy":7},"total_outbound_references":21},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"thesis":"As of 9 August 2026, this Paper Citation Record lists 21 of 21 outbound references and 0 inbound Pith citation observations for arXiv:2506.12366."}