{"as_of":"2026-08-09T22:52:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:78a874a18faab97387adc60661ae1d2c0a8ec13a04ecedda7de4a94a89b10f46","coverage":[{"denominator":46,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":46,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-07T19:50:55.322592Z","state":"measured"},{"denominator":46,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":46,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-09T06:31:02.800959+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2608.05989/citation-record","integrity":"/paper/2608.05989/integrity","json":"/paper/2608.05989/citation-record.json","paper":"/paper/2608.05989"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T19:50:55.106703Z","title":"The Tenth International Conference on Learning Representations,","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2608.05989","last_updated":"2026-08-06T13:02:59Z","snapshot_observed_at":"2026-08-09T22:13:02.729315Z","submitted_at":"2026-08-06T13:02:59Z","title":"Observation-Grounded Self-Predictive Reinforcement Learning for Visual Continuous Control","version":1},"reference_index":1,"source":"arxiv_source","source_observed_at":"2026-08-07T19:50:55.106703Z"},"links":{"citing_paper":"/paper/2608.05989"},"observation_digest":"sha256:d90c60034683272d5cdd8b95359c87183bb41b3c2d3ade036f85ec82e9e18708","observation_id":"70f8bbf5-c083-499b-b138-7c55ee3bd0b0","resolution":{"observed_at":"2026-08-07T19:50:55.106703Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T19:50:55.114149Z","title":"9th International Conference on Learning Representations,","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2608.05989","last_updated":"2026-08-06T13:02:59Z","snapshot_observed_at":"2026-08-09T22:13:02.729315Z","submitted_at":"2026-08-06T13:02:59Z","title":"Observation-Grounded Self-Predictive Reinforcement Learning for Visual Continuous Control","version":1},"reference_index":2,"source":"arxiv_source","source_observed_at":"2026-08-07T19:50:55.114149Z"},"links":{"citing_paper":"/paper/2608.05989"},"observation_digest":"sha256:57bf81709fb3c13d43666875c1716ddb64f7d9047973727cc5f14a6b78b7f76f","observation_id":"33b3baf7-d1ec-4b1a-80f2-0eb2c0550e4f","resolution":{"observed_at":"2026-08-07T19:50:55.114149Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T19:50:55.119713Z","title":"The Thirteenth International Conference on Learning Representations,","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2608.05989","last_updated":"2026-08-06T13:02:59Z","snapshot_observed_at":"2026-08-09T22:13:02.729315Z","submitted_at":"2026-08-06T13:02:59Z","title":"Observation-Grounded Self-Predictive Reinforcement Learning for Visual Continuous Control","version":1},"reference_index":3,"source":"arxiv_source","source_observed_at":"2026-08-07T19:50:55.119713Z"},"links":{"citing_paper":"/paper/2608.05989"},"observation_digest":"sha256:06386b6d22d87b93182d1a395c585eafa9fa1175ce4cb9c8d87b9f209c4c4dd2","observation_id":"f02c9844-45e2-437b-95fe-46b31e5f34e5","resolution":{"observed_at":"2026-08-07T19:50:55.119713Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T19:50:56.063404Z","title":"2026 , eprint=","venue":null,"work_id":"c9cb9804-2e37-4e56-9f20-add9da8339b9","year":2026},"citing_paper":{"arxiv_id":"2608.05989","last_updated":"2026-08-06T13:02:59Z","snapshot_observed_at":"2026-08-09T22:13:02.729315Z","submitted_at":"2026-08-06T13:02:59Z","title":"Observation-Grounded Self-Predictive Reinforcement Learning for Visual Continuous Control","version":1},"reference_index":4,"source":"arxiv_source","source_observed_at":"2026-08-07T19:50:55.124553Z"},"links":{"citing_paper":"/paper/2608.05989"},"observation_digest":"sha256:75c8acfb7f0b9144568f992300234374c01b0686774730ff389e7a604f0e275e","observation_id":"f333489d-8b9f-4a9b-abbc-5e8f0786ba82","resolution":{"observed_at":"2026-08-07T19:50:56.068255Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T19:50:55.129452Z","title":"Devon Hjelm and Aaron C","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2608.05989","last_updated":"2026-08-06T13:02:59Z","snapshot_observed_at":"2026-08-09T22:13:02.729315Z","submitted_at":"2026-08-06T13:02:59Z","title":"Observation-Grounded Self-Predictive Reinforcement Learning for Visual Continuous Control","version":1},"reference_index":5,"source":"arxiv_source","source_observed_at":"2026-08-07T19:50:55.129452Z"},"links":{"citing_paper":"/paper/2608.05989"},"observation_digest":"sha256:22008f7e40e103605be9d57a622dec4260480bbbccb7d91ea3200de2d70805f2","observation_id":"f2aa81e2-72f6-4033-a656-fd0b2c1475bf","resolution":{"observed_at":"2026-08-07T19:50:55.129452Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T19:50:55.136530Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2608.05989","last_updated":"2026-08-06T13:02:59Z","snapshot_observed_at":"2026-08-09T22:13:02.729315Z","submitted_at":"2026-08-06T13:02:59Z","title":"Observation-Grounded Self-Predictive Reinforcement Learning for Visual Continuous Control","version":1},"reference_index":6,"source":"arxiv_source","source_observed_at":"2026-08-07T19:50:55.136530Z"},"links":{"citing_paper":"/paper/2608.05989"},"observation_digest":"sha256:fa2968037f37112bc59de8a1d4cfa224a4ffad357b5f9decbd2afd2dd2556da7","observation_id":"2ba98ed0-caf9-44d3-9e3c-2405716ab346","resolution":{"observed_at":"2026-08-07T19:50:55.136530Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2506.05418","last_updated":"2025-06-05T00:36:54Z","snapshot_observed_at":"2026-08-09T00:14:33.104955Z","submitted_at":"2025-06-05T00:36:54Z","title":"Self-Predictive Dynamics for Generalization of Vision-based Reinforcement Learning","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2506.05418","snapshot_observed_at":"2026-08-07T19:50:55.142822Z","title":"CoRR , volume =","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2608.05989","last_updated":"2026-08-06T13:02:59Z","snapshot_observed_at":"2026-08-09T22:13:02.729315Z","submitted_at":"2026-08-06T13:02:59Z","title":"Observation-Grounded Self-Predictive Reinforcement Learning for Visual Continuous Control","version":1},"reference_index":7,"source":"arxiv_source","source_observed_at":"2026-08-07T19:50:55.142822Z"},"links":{"cited_paper":"/paper/2506.05418","citing_paper":"/paper/2608.05989"},"observation_digest":"sha256:92e72332c076de0a1c2a7ecc228d7e4845e45babf00a01db1c6db063adc650a2","observation_id":"3099247d-7847-415c-9bac-1e74d0e232df","resolution":{"observed_at":"2026-08-07T19:50:55.142822Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T19:50:55.150547Z","title":"Bootstrap Your Own Latent -","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2608.05989","last_updated":"2026-08-06T13:02:59Z","snapshot_observed_at":"2026-08-09T22:13:02.729315Z","submitted_at":"2026-08-06T13:02:59Z","title":"Observation-Grounded Self-Predictive Reinforcement Learning for Visual Continuous Control","version":1},"reference_index":8,"source":"arxiv_source","source_observed_at":"2026-08-07T19:50:55.150547Z"},"links":{"citing_paper":"/paper/2608.05989"},"observation_digest":"sha256:4bf44d3d4605c32b89c1d881a973cbcd73052ffa8720f816973d9debe8416c10","observation_id":"2e8097b2-c833-40da-88d5-b4d0b9abc10f","resolution":{"observed_at":"2026-08-07T19:50:55.150547Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T19:50:55.155467Z","title":"Bellemare , editor =","venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2608.05989","last_updated":"2026-08-06T13:02:59Z","snapshot_observed_at":"2026-08-09T22:13:02.729315Z","submitted_at":"2026-08-06T13:02:59Z","title":"Observation-Grounded Self-Predictive Reinforcement Learning for Visual Continuous Control","version":1},"reference_index":9,"source":"arxiv_source","source_observed_at":"2026-08-07T19:50:55.155467Z"},"links":{"citing_paper":"/paper/2608.05989"},"observation_digest":"sha256:10b019f3af18df411ca7a79a29d7bfd8f052c1cd089be51904df31fa9396f43b","observation_id":"742550d0-9639-456b-a81a-e0d3a570360a","resolution":{"observed_at":"2026-08-07T19:50:55.155467Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T19:50:55.160692Z","title":"Nature , pages=","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2608.05989","last_updated":"2026-08-06T13:02:59Z","snapshot_observed_at":"2026-08-09T22:13:02.729315Z","submitted_at":"2026-08-06T13:02:59Z","title":"Observation-Grounded Self-Predictive Reinforcement Learning for Visual Continuous Control","version":1},"reference_index":10,"source":"arxiv_source","source_observed_at":"2026-08-07T19:50:55.160692Z"},"links":{"citing_paper":"/paper/2608.05989"},"observation_digest":"sha256:1494a480c607c7043b64d6fcdf38efa2f0584f56eac89187b2627b37191d308e","observation_id":"5bc959e7-1b58-4254-a4d1-f719f17cba5e","resolution":{"observed_at":"2026-08-07T19:50:55.160692Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T19:50:55.164893Z","title":"The Twelfth International Conference on Learning Representations,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2608.05989","last_updated":"2026-08-06T13:02:59Z","snapshot_observed_at":"2026-08-09T22:13:02.729315Z","submitted_at":"2026-08-06T13:02:59Z","title":"Observation-Grounded Self-Predictive Reinforcement Learning for Visual Continuous Control","version":1},"reference_index":11,"source":"arxiv_source","source_observed_at":"2026-08-07T19:50:55.164893Z"},"links":{"citing_paper":"/paper/2608.05989"},"observation_digest":"sha256:479d840af4d3ba14780a552fda828b143192e826fd6ce63352afda26ef04643e","observation_id":"7a64627a-3197-4021-89b2-d60bd8df7b62","resolution":{"observed_at":"2026-08-07T19:50:55.164893Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T19:50:55.170051Z","title":"1998 , publisher=","venue":null,"work_id":null,"year":1998},"citing_paper":{"arxiv_id":"2608.05989","last_updated":"2026-08-06T13:02:59Z","snapshot_observed_at":"2026-08-09T22:13:02.729315Z","submitted_at":"2026-08-06T13:02:59Z","title":"Observation-Grounded Self-Predictive Reinforcement Learning for Visual Continuous Control","version":1},"reference_index":12,"source":"arxiv_source","source_observed_at":"2026-08-07T19:50:55.170051Z"},"links":{"citing_paper":"/paper/2608.05989"},"observation_digest":"sha256:381d8a1c3272d5171fce2cff55a2664706802f9f7b88dcbcff704db4a10d9d1b","observation_id":"c2607cca-0233-43f1-99d7-ce112c7cb423","resolution":{"observed_at":"2026-08-07T19:50:55.170051Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1801.00690","last_updated":"2018-01-02T15:48:14Z","snapshot_observed_at":"2026-08-01T20:24:08.300098Z","submitted_at":"2018-01-02T15:48:14Z","title":"DeepMind Control Suite","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1801.00690","snapshot_observed_at":"2026-08-07T19:50:55.174248Z","title":"Lillicrap and Martin A","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2608.05989","last_updated":"2026-08-06T13:02:59Z","snapshot_observed_at":"2026-08-09T22:13:02.729315Z","submitted_at":"2026-08-06T13:02:59Z","title":"Observation-Grounded Self-Predictive Reinforcement Learning for Visual Continuous Control","version":1},"reference_index":13,"source":"arxiv_source","source_observed_at":"2026-08-07T19:50:55.174248Z"},"links":{"cited_paper":"/paper/1801.00690","citing_paper":"/paper/2608.05989"},"observation_digest":"sha256:7de7ae7b41898b0fe49a781c8faf502c110f582d040968e4dfea8b2f93b11718","observation_id":"6b8bd82d-8b77-42f1-9d24-19a98fe5eaa5","resolution":{"observed_at":"2026-08-07T19:50:55.174248Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T19:50:55.179439Z","title":"Learning Representations via a Robust Behavioral Metric for Deep Reinforcement Learning , booktitle =","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2608.05989","last_updated":"2026-08-06T13:02:59Z","snapshot_observed_at":"2026-08-09T22:13:02.729315Z","submitted_at":"2026-08-06T13:02:59Z","title":"Observation-Grounded Self-Predictive Reinforcement Learning for Visual Continuous Control","version":1},"reference_index":14,"source":"arxiv_source","source_observed_at":"2026-08-07T19:50:55.179439Z"},"links":{"citing_paper":"/paper/2608.05989"},"observation_digest":"sha256:4d62535629f8e7904b67c9609966f4a1fd10c8c2f054fb5277d724e77e23ba7d","observation_id":"7ebaee02-974c-435c-96a0-778d6b48168d","resolution":{"observed_at":"2026-08-07T19:50:55.179439Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T19:50:55.184306Z","title":"MICo: Improved representations via sampling-based state similarity for Markov decision processes , booktitle =","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2608.05989","last_updated":"2026-08-06T13:02:59Z","snapshot_observed_at":"2026-08-09T22:13:02.729315Z","submitted_at":"2026-08-06T13:02:59Z","title":"Observation-Grounded Self-Predictive Reinforcement Learning for Visual Continuous Control","version":1},"reference_index":15,"source":"arxiv_source","source_observed_at":"2026-08-07T19:50:55.184306Z"},"links":{"citing_paper":"/paper/2608.05989"},"observation_digest":"sha256:d4c52454832f78c5c7ae0c4a33c04d76c046306f3cc87df949e321ca2277ffe0","observation_id":"5470763c-854e-4486-aed0-a4f90b8b1abb","resolution":{"observed_at":"2026-08-07T19:50:55.184306Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T19:50:55.188694Z","title":"The Twelfth International Conference on Learning Representations,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2608.05989","last_updated":"2026-08-06T13:02:59Z","snapshot_observed_at":"2026-08-09T22:13:02.729315Z","submitted_at":"2026-08-06T13:02:59Z","title":"Observation-Grounded Self-Predictive Reinforcement Learning for Visual Continuous Control","version":1},"reference_index":16,"source":"arxiv_source","source_observed_at":"2026-08-07T19:50:55.188694Z"},"links":{"citing_paper":"/paper/2608.05989"},"observation_digest":"sha256:c2aa24476228062f990cba8ce66259e4334756d4b2d0871d8a5419a17a42ef12","observation_id":"8380536b-f784-4b7e-b026-a5f9f8dd37d6","resolution":{"observed_at":"2026-08-07T19:50:55.188694Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T19:50:55.192580Z","title":"Why do We Need Large Batchsizes in Contrastive Learning?","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2608.05989","last_updated":"2026-08-06T13:02:59Z","snapshot_observed_at":"2026-08-09T22:13:02.729315Z","submitted_at":"2026-08-06T13:02:59Z","title":"Observation-Grounded Self-Predictive Reinforcement Learning for Visual Continuous Control","version":1},"reference_index":17,"source":"arxiv_source","source_observed_at":"2026-08-07T19:50:55.192580Z"},"links":{"citing_paper":"/paper/2608.05989"},"observation_digest":"sha256:ad475cd6defda4bf53f0820b65d4309ab1747dee963e8db23d2674e94f05b30b","observation_id":"2aa67b88-d9a5-4ffb-8831-2837a4577fa5","resolution":{"observed_at":"2026-08-07T19:50:55.192580Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T19:50:55.196626Z","title":"Contrastive Learning as Goal-Conditioned Reinforcement Learning , booktitle =","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2608.05989","last_updated":"2026-08-06T13:02:59Z","snapshot_observed_at":"2026-08-09T22:13:02.729315Z","submitted_at":"2026-08-06T13:02:59Z","title":"Observation-Grounded Self-Predictive Reinforcement Learning for Visual Continuous Control","version":1},"reference_index":18,"source":"arxiv_source","source_observed_at":"2026-08-07T19:50:55.196626Z"},"links":{"citing_paper":"/paper/2608.05989"},"observation_digest":"sha256:f17aa661e4a91a6cccb4bac426d36587072b63dd5bfafab9c379d768cb909260","observation_id":"f0b19d9e-6c6d-496e-a00e-35464c474cf5","resolution":{"observed_at":"2026-08-07T19:50:55.196626Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T19:50:55.200769Z","title":"The Thirteenth International Conference on Learning Representations,","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2608.05989","last_updated":"2026-08-06T13:02:59Z","snapshot_observed_at":"2026-08-09T22:13:02.729315Z","submitted_at":"2026-08-06T13:02:59Z","title":"Observation-Grounded Self-Predictive Reinforcement Learning for Visual Continuous Control","version":1},"reference_index":19,"source":"arxiv_source","source_observed_at":"2026-08-07T19:50:55.200769Z"},"links":{"citing_paper":"/paper/2608.05989"},"observation_digest":"sha256:9c17c140c54018d506a9d5136d5203a6251d32b4df0fd3c5b54fad3f7d81dbac","observation_id":"ed2aae50-3ac5-443f-8856-d497d0375c09","resolution":{"observed_at":"2026-08-07T19:50:55.200769Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T19:50:55.204994Z","title":"Policy-Independent Behavioral Metric-Based Representation for Deep Reinforcement Learning , booktitle =","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2608.05989","last_updated":"2026-08-06T13:02:59Z","snapshot_observed_at":"2026-08-09T22:13:02.729315Z","submitted_at":"2026-08-06T13:02:59Z","title":"Observation-Grounded Self-Predictive Reinforcement Learning for Visual Continuous Control","version":1},"reference_index":20,"source":"arxiv_source","source_observed_at":"2026-08-07T19:50:55.204994Z"},"links":{"citing_paper":"/paper/2608.05989"},"observation_digest":"sha256:b6f78f2ec349fdbc982ad9d0bc565f447644baa821dcf5fa3115d42f78c6c55a","observation_id":"2683690d-ce08-4a86-b381-375cdc591bcc","resolution":{"observed_at":"2026-08-07T19:50:55.204994Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":"10.48550/arxiv.2507.18519","metadata_source":"doi_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T20:28:40.151424Z","title":"Revisiting Bisimulation Metric for Robust Representations in Reinforcement Learning , journal =","venue":null,"work_id":"9e78990c-c2d1-4575-b067-0d762bdc9577","year":2025},"citing_paper":{"arxiv_id":"2608.05989","last_updated":"2026-08-06T13:02:59Z","snapshot_observed_at":"2026-08-09T22:13:02.729315Z","submitted_at":"2026-08-06T13:02:59Z","title":"Observation-Grounded Self-Predictive Reinforcement Learning for Visual Continuous Control","version":1},"reference_index":21,"source":"arxiv_source","source_observed_at":"2026-08-07T19:50:55.209108Z"},"links":{"citing_paper":"/paper/2608.05989"},"observation_digest":"sha256:a78a05f57f8049d98e96c93aa5aaa2d6bd69c1a8e21bfeeed38256dd798ea204","observation_id":"16ca6a2f-4eed-4c5b-b680-5122ed05b2be","resolution":{"observed_at":"2026-08-07T20:28:40.158365Z","resolver_source":"doi","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T19:50:55.213520Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2608.05989","last_updated":"2026-08-06T13:02:59Z","snapshot_observed_at":"2026-08-09T22:13:02.729315Z","submitted_at":"2026-08-06T13:02:59Z","title":"Observation-Grounded Self-Predictive Reinforcement Learning for Visual Continuous Control","version":1},"reference_index":22,"source":"arxiv_source","source_observed_at":"2026-08-07T19:50:55.213520Z"},"links":{"citing_paper":"/paper/2608.05989"},"observation_digest":"sha256:b4c2a4d0c0950eda41376cb06688cf4915a18e78641044d40bf39d6198c0eada","observation_id":"c460febb-5bb8-4876-9045-1277b32e1f2b","resolution":{"observed_at":"2026-08-07T19:50:55.213520Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T19:50:55.218002Z","title":"Jha and Toshisada Mariyama and Daniel Nikovski , title =","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2608.05989","last_updated":"2026-08-06T13:02:59Z","snapshot_observed_at":"2026-08-09T22:13:02.729315Z","submitted_at":"2026-08-06T13:02:59Z","title":"Observation-Grounded Self-Predictive Reinforcement Learning for Visual Continuous Control","version":1},"reference_index":23,"source":"arxiv_source","source_observed_at":"2026-08-07T19:50:55.218002Z"},"links":{"citing_paper":"/paper/2608.05989"},"observation_digest":"sha256:c206c49933b766cfb9db3bcf1b0bbe55943dc33b065cf45994a48c6c102a0b34","observation_id":"ed64c26d-bea8-4255-9f60-ae6046beac66","resolution":{"observed_at":"2026-08-07T19:50:55.218002Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T19:50:55.222580Z","title":"Lillicrap and Jimmy Ba and Mohammad Norouzi , title =","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2608.05989","last_updated":"2026-08-06T13:02:59Z","snapshot_observed_at":"2026-08-09T22:13:02.729315Z","submitted_at":"2026-08-06T13:02:59Z","title":"Observation-Grounded Self-Predictive Reinforcement Learning for Visual Continuous Control","version":1},"reference_index":24,"source":"arxiv_source","source_observed_at":"2026-08-07T19:50:55.222580Z"},"links":{"citing_paper":"/paper/2608.05989"},"observation_digest":"sha256:65a8f22d5621d351c2fefa23cd60586be46619805fad1d127d318a424366da17","observation_id":"8289d601-ef67-4ff0-a70d-962a4d4a88f9","resolution":{"observed_at":"2026-08-07T19:50:55.222580Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T19:50:55.227135Z","title":"Lillicrap and Mohammad Norouzi and Jimmy Ba , title =","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2608.05989","last_updated":"2026-08-06T13:02:59Z","snapshot_observed_at":"2026-08-09T22:13:02.729315Z","submitted_at":"2026-08-06T13:02:59Z","title":"Observation-Grounded Self-Predictive Reinforcement Learning for Visual Continuous Control","version":1},"reference_index":25,"source":"arxiv_source","source_observed_at":"2026-08-07T19:50:55.227135Z"},"links":{"citing_paper":"/paper/2608.05989"},"observation_digest":"sha256:c2e9b6945458577d2708e71debd6acdeced4e1344230a6cd8fb378b99aa99375","observation_id":"28f58bd8-0901-41a2-82cd-026e8f5dca28","resolution":{"observed_at":"2026-08-07T19:50:55.227135Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T19:50:55.231756Z","title":"Addressing Function Approximation Error in Actor-Critic Methods , booktitle =","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2608.05989","last_updated":"2026-08-06T13:02:59Z","snapshot_observed_at":"2026-08-09T22:13:02.729315Z","submitted_at":"2026-08-06T13:02:59Z","title":"Observation-Grounded Self-Predictive Reinforcement Learning for Visual Continuous Control","version":1},"reference_index":26,"source":"arxiv_source","source_observed_at":"2026-08-07T19:50:55.231756Z"},"links":{"citing_paper":"/paper/2608.05989"},"observation_digest":"sha256:9a26e0b87edd3ed5350244c71dff0668a83864421318925d9bd8b16309c56e89","observation_id":"ef18c18d-6712-40fb-9ce8-2d130f536c07","resolution":{"observed_at":"2026-08-07T19:50:55.231756Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T19:50:55.605260Z","title":null,"venue":null,"work_id":"15479738-82f4-434d-86ec-e17de808f808","year":2012},"citing_paper":{"arxiv_id":"2608.05989","last_updated":"2026-08-06T13:02:59Z","snapshot_observed_at":"2026-08-09T22:13:02.729315Z","submitted_at":"2026-08-06T13:02:59Z","title":"Observation-Grounded Self-Predictive Reinforcement Learning for Visual Continuous Control","version":1},"reference_index":27,"source":"arxiv_source","source_observed_at":"2026-08-07T19:50:55.235969Z"},"links":{"citing_paper":"/paper/2608.05989"},"observation_digest":"sha256:04ce7c06ca32c461e9f4dae4d5ea10921c3627f843870630cea929fc7edacfb7","observation_id":"9664dc32-8ab1-4c3c-bf79-8d8b0e49c25c","resolution":{"observed_at":"2026-08-07T19:50:55.725061Z","resolver_source":"arxiv_id_nonexistent","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T19:50:55.240605Z","title":"PyTorch: An Imperative Style, High-Performance Deep Learning Library , booktitle =","venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2608.05989","last_updated":"2026-08-06T13:02:59Z","snapshot_observed_at":"2026-08-09T22:13:02.729315Z","submitted_at":"2026-08-06T13:02:59Z","title":"Observation-Grounded Self-Predictive Reinforcement Learning for Visual Continuous Control","version":1},"reference_index":28,"source":"arxiv_source","source_observed_at":"2026-08-07T19:50:55.240605Z"},"links":{"citing_paper":"/paper/2608.05989"},"observation_digest":"sha256:e80864556226e1f37b0666129747c0b468b5739ff03815eb36b0e6f86d9d971a","observation_id":"387b0585-0ad9-44dc-b0dd-ee4973e7dd0b","resolution":{"observed_at":"2026-08-07T19:50:55.240605Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T19:50:55.245059Z","title":null,"venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2608.05989","last_updated":"2026-08-06T13:02:59Z","snapshot_observed_at":"2026-08-09T22:13:02.729315Z","submitted_at":"2026-08-06T13:02:59Z","title":"Observation-Grounded Self-Predictive Reinforcement Learning for Visual Continuous Control","version":1},"reference_index":29,"source":"arxiv_source","source_observed_at":"2026-08-07T19:50:55.245059Z"},"links":{"citing_paper":"/paper/2608.05989"},"observation_digest":"sha256:c154a52f5f3fabc6c897f66ab53d379bdcf20f2f4a25a906d0ba1fa2b7402968","observation_id":"a93136d4-f3e5-4371-bd47-17651c25987e","resolution":{"observed_at":"2026-08-07T19:50:55.245059Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T19:50:55.249557Z","title":"Bellemare and Yavar Naddaf and Joel Veness and Michael Bowling , title =","venue":null,"work_id":null,"year":2013},"citing_paper":{"arxiv_id":"2608.05989","last_updated":"2026-08-06T13:02:59Z","snapshot_observed_at":"2026-08-09T22:13:02.729315Z","submitted_at":"2026-08-06T13:02:59Z","title":"Observation-Grounded Self-Predictive Reinforcement Learning for Visual Continuous Control","version":1},"reference_index":30,"source":"arxiv_source","source_observed_at":"2026-08-07T19:50:55.249557Z"},"links":{"citing_paper":"/paper/2608.05989"},"observation_digest":"sha256:67bfd21a11c3b85516048c420692ed05fada9e0e8dbfd66daf03ad4dc0e1c762","observation_id":"1f1560d1-cc78-49a0-8e93-a3348a4d7dfc","resolution":{"observed_at":"2026-08-07T19:50:55.249557Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2406.02696","last_updated":"2024-06-04T18:15:44Z","snapshot_observed_at":"2026-08-09T21:44:33.522212Z","submitted_at":"2024-06-04T18:15:44Z","title":"iQRL -- Implicitly Quantized Representations for Sample-efficient Reinforcement Learning","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2406.02696","snapshot_observed_at":"2026-08-07T19:50:55.254650Z","title":"iQRL - Implicitly Quantized Representations for Sample-efficient Reinforcement Learning , journal =","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2608.05989","last_updated":"2026-08-06T13:02:59Z","snapshot_observed_at":"2026-08-09T22:13:02.729315Z","submitted_at":"2026-08-06T13:02:59Z","title":"Observation-Grounded Self-Predictive Reinforcement Learning for Visual Continuous Control","version":1},"reference_index":31,"source":"arxiv_source","source_observed_at":"2026-08-07T19:50:55.254650Z"},"links":{"cited_paper":"/paper/2406.02696","citing_paper":"/paper/2608.05989"},"observation_digest":"sha256:7c93a2a40c16be2eafaa3978e6256dabc54b56188068b269565ccf71450ebd6f","observation_id":"0a611bef-90f0-4ad1-9dab-3692975237b0","resolution":{"observed_at":"2026-08-07T19:50:55.254650Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T19:50:55.260065Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2608.05989","last_updated":"2026-08-06T13:02:59Z","snapshot_observed_at":"2026-08-09T22:13:02.729315Z","submitted_at":"2026-08-06T13:02:59Z","title":"Observation-Grounded Self-Predictive Reinforcement Learning for Visual Continuous Control","version":1},"reference_index":32,"source":"arxiv_source","source_observed_at":"2026-08-07T19:50:55.260065Z"},"links":{"citing_paper":"/paper/2608.05989"},"observation_digest":"sha256:a13ec27f583caf1440b7451ed0e21dc3d5e25d9e78a0732d7c3ebeff639cc803","observation_id":"abc2af7a-487c-4aec-aea6-9b90659cbd4e","resolution":{"observed_at":"2026-08-07T19:50:55.260065Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T19:50:55.264601Z","title":"Riedmiller , title =","venue":null,"work_id":null,"year":2014},"citing_paper":{"arxiv_id":"2608.05989","last_updated":"2026-08-06T13:02:59Z","snapshot_observed_at":"2026-08-09T22:13:02.729315Z","submitted_at":"2026-08-06T13:02:59Z","title":"Observation-Grounded Self-Predictive Reinforcement Learning for Visual Continuous Control","version":1},"reference_index":33,"source":"arxiv_source","source_observed_at":"2026-08-07T19:50:55.264601Z"},"links":{"citing_paper":"/paper/2608.05989"},"observation_digest":"sha256:d576e20f89afc4a31da3eb2131f05a67b0f502fbb4eed76b72c78aa33f9d5a8f","observation_id":"752608e7-b9b6-409c-8b2b-3dbfb8dd66d9","resolution":{"observed_at":"2026-08-07T19:50:55.264601Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T19:50:55.269609Z","title":"Lillicrap and David Silver , title =","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2608.05989","last_updated":"2026-08-06T13:02:59Z","snapshot_observed_at":"2026-08-09T22:13:02.729315Z","submitted_at":"2026-08-06T13:02:59Z","title":"Observation-Grounded Self-Predictive Reinforcement Learning for Visual Continuous Control","version":1},"reference_index":34,"source":"arxiv_source","source_observed_at":"2026-08-07T19:50:55.269609Z"},"links":{"citing_paper":"/paper/2608.05989"},"observation_digest":"sha256:185db3944a44652b3351a9cdd8f5b2ff04c82346cd712c533a3aecec0c62161d","observation_id":"092a16b1-f764-431a-b83d-c425b2d5de6d","resolution":{"observed_at":"2026-08-07T19:50:55.269609Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T19:50:55.274985Z","title":"Dueling Network Architectures for Deep Reinforcement Learning , booktitle =","venue":null,"work_id":null,"year":2016},"citing_paper":{"arxiv_id":"2608.05989","last_updated":"2026-08-06T13:02:59Z","snapshot_observed_at":"2026-08-09T22:13:02.729315Z","submitted_at":"2026-08-06T13:02:59Z","title":"Observation-Grounded Self-Predictive Reinforcement Learning for Visual Continuous Control","version":1},"reference_index":35,"source":"arxiv_source","source_observed_at":"2026-08-07T19:50:55.274985Z"},"links":{"citing_paper":"/paper/2608.05989"},"observation_digest":"sha256:6db0176bfe681e3f117aa48d02200b286a79e9db3e321218e8421bb2c9ebd7e5","observation_id":"828aa1f2-a9c7-4ed1-8d74-fcdb39e16650","resolution":{"observed_at":"2026-08-07T19:50:55.274985Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T19:50:55.280007Z","title":"Temporal Difference Learning for Model Predictive Control , booktitle =","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2608.05989","last_updated":"2026-08-06T13:02:59Z","snapshot_observed_at":"2026-08-09T22:13:02.729315Z","submitted_at":"2026-08-06T13:02:59Z","title":"Observation-Grounded Self-Predictive Reinforcement Learning for Visual Continuous Control","version":1},"reference_index":36,"source":"arxiv_source","source_observed_at":"2026-08-07T19:50:55.280007Z"},"links":{"citing_paper":"/paper/2608.05989"},"observation_digest":"sha256:38c8fb08feb4447402da2c9b01af3a617fbf942568dba2a136e20dd9afb77039","observation_id":"c1e32949-7edd-4447-a08e-4449724fc160","resolution":{"observed_at":"2026-08-07T19:50:55.280007Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1312.5602","last_updated":"2013-12-19T16:00:08Z","snapshot_observed_at":"2026-07-06T03:31:23.521122Z","submitted_at":"2013-12-19T16:00:08Z","title":"Playing Atari with Deep Reinforcement Learning","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1312.5602","snapshot_observed_at":"2026-08-07T19:50:55.284821Z","title":"Riedmiller , title =","venue":null,"work_id":null,"year":2013},"citing_paper":{"arxiv_id":"2608.05989","last_updated":"2026-08-06T13:02:59Z","snapshot_observed_at":"2026-08-09T22:13:02.729315Z","submitted_at":"2026-08-06T13:02:59Z","title":"Observation-Grounded Self-Predictive Reinforcement Learning for Visual Continuous Control","version":1},"reference_index":37,"source":"arxiv_source","source_observed_at":"2026-08-07T19:50:55.284821Z"},"links":{"cited_paper":"/paper/1312.5602","citing_paper":"/paper/2608.05989"},"observation_digest":"sha256:438f4dfdf7c0ae5de3681f9510f79781443cbde80edef3cdbdf274d7486cf924","observation_id":"801d486f-df15-4acb-9347-360e6b15700d","resolution":{"observed_at":"2026-08-07T19:50:55.284821Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T19:50:55.290014Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2608.05989","last_updated":"2026-08-06T13:02:59Z","snapshot_observed_at":"2026-08-09T22:13:02.729315Z","submitted_at":"2026-08-06T13:02:59Z","title":"Observation-Grounded Self-Predictive Reinforcement Learning for Visual Continuous Control","version":1},"reference_index":38,"source":"arxiv_source","source_observed_at":"2026-08-07T19:50:55.290014Z"},"links":{"citing_paper":"/paper/2608.05989"},"observation_digest":"sha256:23713dbf636736c495e864e172ee2974a5d80061a9d43d1fb2170965361ab88c","observation_id":"61c003ba-2668-4556-b96e-a77f5f106b79","resolution":{"observed_at":"2026-08-07T19:50:55.290014Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T19:50:55.294231Z","title":"An Equivalence between Loss Functions and Non-Uniform Sampling in Experience Replay , booktitle =","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2608.05989","last_updated":"2026-08-06T13:02:59Z","snapshot_observed_at":"2026-08-09T22:13:02.729315Z","submitted_at":"2026-08-06T13:02:59Z","title":"Observation-Grounded Self-Predictive Reinforcement Learning for Visual Continuous Control","version":1},"reference_index":39,"source":"arxiv_source","source_observed_at":"2026-08-07T19:50:55.294231Z"},"links":{"citing_paper":"/paper/2608.05989"},"observation_digest":"sha256:8f4a2e4491ebad458136292c3de80a6e7e953e68dd89004e6e8b2186b38cf412","observation_id":"aaaaff90-c96b-4c44-80b3-bdce4bb00364","resolution":{"observed_at":"2026-08-07T19:50:55.294231Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T19:50:55.298383Z","title":"7th International Conference on Learning Representations,","venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2608.05989","last_updated":"2026-08-06T13:02:59Z","snapshot_observed_at":"2026-08-09T22:13:02.729315Z","submitted_at":"2026-08-06T13:02:59Z","title":"Observation-Grounded Self-Predictive Reinforcement Learning for Visual Continuous Control","version":1},"reference_index":40,"source":"arxiv_source","source_observed_at":"2026-08-07T19:50:55.298383Z"},"links":{"citing_paper":"/paper/2608.05989"},"observation_digest":"sha256:148151c584f20563e6f567bf6fd2df5e66e91337b05e022de6d3d69730c9376a","observation_id":"0e38009e-4199-4e00-b127-93432429b884","resolution":{"observed_at":"2026-08-07T19:50:55.298383Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T19:50:55.302389Z","title":"Rusu and Joel Veness and Marc G","venue":null,"work_id":null,"year":2015},"citing_paper":{"arxiv_id":"2608.05989","last_updated":"2026-08-06T13:02:59Z","snapshot_observed_at":"2026-08-09T22:13:02.729315Z","submitted_at":"2026-08-06T13:02:59Z","title":"Observation-Grounded Self-Predictive Reinforcement Learning for Visual Continuous Control","version":1},"reference_index":41,"source":"arxiv_source","source_observed_at":"2026-08-07T19:50:55.302389Z"},"links":{"citing_paper":"/paper/2608.05989"},"observation_digest":"sha256:37c9da739cf565b527d74be5cdbcdfb020212d5e11e47f7d5aedc66abb848c20","observation_id":"c75dcacf-ab62-478b-b56c-298d2110f20c","resolution":{"observed_at":"2026-08-07T19:50:55.302389Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T19:50:55.306714Z","title":"Rainbow: Combining Improvements in Deep Reinforcement Learning , booktitle =","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2608.05989","last_updated":"2026-08-06T13:02:59Z","snapshot_observed_at":"2026-08-09T22:13:02.729315Z","submitted_at":"2026-08-06T13:02:59Z","title":"Observation-Grounded Self-Predictive Reinforcement Learning for Visual Continuous Control","version":1},"reference_index":42,"source":"arxiv_source","source_observed_at":"2026-08-07T19:50:55.306714Z"},"links":{"citing_paper":"/paper/2608.05989"},"observation_digest":"sha256:90a8bf138f62432f7c0b0d8d11ce0148e37f3a4f7273e9cae42f37e27b85eb2d","observation_id":"6b0fe33d-156b-4fc2-aac7-c2da019b261e","resolution":{"observed_at":"2026-08-07T19:50:55.306714Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T19:50:55.310725Z","title":"Bridging State and History Representations: Understanding Self-Predictive","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2608.05989","last_updated":"2026-08-06T13:02:59Z","snapshot_observed_at":"2026-08-09T22:13:02.729315Z","submitted_at":"2026-08-06T13:02:59Z","title":"Observation-Grounded Self-Predictive Reinforcement Learning for Visual Continuous Control","version":1},"reference_index":43,"source":"arxiv_source","source_observed_at":"2026-08-07T19:50:55.310725Z"},"links":{"citing_paper":"/paper/2608.05989"},"observation_digest":"sha256:bff09c1ceedc9560a13433e5e99cf653f472b41b67201cbce6966fc0cf46638d","observation_id":"e2125a36-ed36-42ae-8eb3-82a80433d8e9","resolution":{"observed_at":"2026-08-07T19:50:55.310725Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T19:50:55.781442Z","title":"When does Self-Prediction help? Understanding Auxiliary Tasks in Reinforcement Learning , journal =","venue":null,"work_id":"fc52aafa-e7f0-4214-8fed-d023867e47c1","year":2024},"citing_paper":{"arxiv_id":"2608.05989","last_updated":"2026-08-06T13:02:59Z","snapshot_observed_at":"2026-08-09T22:13:02.729315Z","submitted_at":"2026-08-06T13:02:59Z","title":"Observation-Grounded Self-Predictive Reinforcement Learning for Visual Continuous Control","version":1},"reference_index":44,"source":"arxiv_source","source_observed_at":"2026-08-07T19:50:55.314650Z"},"links":{"citing_paper":"/paper/2608.05989"},"observation_digest":"sha256:092287e16bdd1b1a026ffc50101cb1676b5f05a9019acdb06a04218862f451f5","observation_id":"a7e79f2c-9482-446a-9e76-e0b77d3e95c7","resolution":{"observed_at":"2026-08-07T19:50:55.786798Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T19:50:55.763223Z","title":null,"venue":null,"work_id":"32c9729b-d315-4576-b4bb-ae2b8f46c8d2","year":null},"citing_paper":{"arxiv_id":"2608.05989","last_updated":"2026-08-06T13:02:59Z","snapshot_observed_at":"2026-08-09T22:13:02.729315Z","submitted_at":"2026-08-06T13:02:59Z","title":"Observation-Grounded Self-Predictive Reinforcement Learning for Visual Continuous Control","version":1},"reference_index":45,"source":"arxiv_source","source_observed_at":"2026-08-07T19:50:55.318512Z"},"links":{"citing_paper":"/paper/2608.05989"},"observation_digest":"sha256:a30b703e8e25a054784dd33f8c07c91f5a4ba7cf208b6fbda065da7139f0392d","observation_id":"b2f98dab-07fc-4322-8d22-b1af9b9e4d3e","resolution":{"observed_at":"2026-08-07T19:50:55.768511Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T19:50:55.322592Z","title":"2026 , note =","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2608.05989","last_updated":"2026-08-06T13:02:59Z","snapshot_observed_at":"2026-08-09T22:13:02.729315Z","submitted_at":"2026-08-06T13:02:59Z","title":"Observation-Grounded Self-Predictive Reinforcement Learning for Visual Continuous Control","version":1},"reference_index":46,"source":"arxiv_source","source_observed_at":"2026-08-07T19:50:55.322592Z"},"links":{"citing_paper":"/paper/2608.05989"},"observation_digest":"sha256:ded45406b6b63c8e5bb0d6a058940fde706296063f8fa951ef56526304f0f16c","observation_id":"4fa723eb-1088-43f5-95c8-91dcf55d2267","resolution":{"observed_at":"2026-08-07T19:50:55.322592Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"paper":{"arxiv_id":"2608.05989","last_updated":"2026-08-06T13:02:59Z","latest_version":1,"primary_category":"cs.LG","snapshot_observed_at":"2026-08-09T22:13:02.729315Z","submitted_at":"2026-08-06T13:02:59Z","title":"Observation-Grounded Self-Predictive Reinforcement Learning for Visual Continuous Control"},"reference_resolution":{"displayed":46,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":42,"verified_exact":2,"verified_fuzzy":2},"total_outbound_references":46},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"thesis":"As of 9 August 2026, this Paper Citation Record lists 46 of 46 outbound references and 0 inbound Pith citation observations for arXiv:2608.05989."}