{"as_of":"2026-08-15T05:31:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:a1972ebd4018f7bb4a06936fa989701d8be8131ee0acb590a8ee7971b77a56f5","coverage":[{"denominator":157,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":100,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-06T23:34:41.099059Z","state":"measured"},{"denominator":107,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":107,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-14T06:32:32.682623+00:00","state":"measured"},{"denominator":7,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":7,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-12T00:48:43.522343Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"arxiv_reference","source_observed_at":"2026-07-04T07:59:40.694649Z","state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2506.17518","last_updated":"2025-06-20T23:47:04Z","snapshot_observed_at":"2026-08-10T10:35:48.301748Z","submitted_at":"2025-06-20T23:47:04Z","title":"A Survey of State Representation Learning for Deep Reinforcement Learning","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2506.17518","snapshot_observed_at":"2026-08-04T08:46:26.662381Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2510.19244","last_updated":"2026-07-18T15:48:05Z","snapshot_observed_at":"2026-08-09T00:14:59.019997Z","submitted_at":"2025-10-22T05:04:43Z","title":"Interpret Policies in Deep Reinforcement Learning using SILVER with RL-Guided Labeling: A Model-level Approach to High-dimensional and Multi-action Environments","version":3},"reference_index":14,"source":"arxiv_source","source_observed_at":"2026-08-04T08:46:26.662381Z"},"links":{"cited_paper":"/paper/2506.17518","citing_paper":"/paper/2510.19244"},"observation_digest":"sha256:8786db4e298b1593773be0bef5c50a8faafa090034a3b69f5a5637d5597421dc","observation_id":"ed9024be-4180-4384-af60-c34f0e2c26fc","resolution":{"observed_at":"2026-08-04T08:46:26.662381Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2506.17518","last_updated":"2025-06-20T23:47:04Z","snapshot_observed_at":"2026-08-10T10:35:48.301748Z","submitted_at":"2025-06-20T23:47:04Z","title":"A Survey of State Representation Learning for Deep Reinforcement Learning","version":1},"cited_work":{"arxiv_id":"2506.17518","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2506.17518","snapshot_observed_at":"2026-07-04T07:59:40.694649Z","title":"A Survey of State Representation Learning for Deep Reinforcement Learning, June 2025","venue":null,"work_id":"27e3bbd8-8b1c-4b24-9add-ee93fbad104e","year":2025},"citing_paper":{"arxiv_id":"2604.09671","last_updated":"2026-04-01T22:28:38Z","snapshot_observed_at":"2026-08-11T19:11:36.669308Z","submitted_at":"2026-04-01T22:28:38Z","title":"Belief-State RWKV for Reinforcement Learning under Partial Observability","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-05-13T21:56:09.642064Z"},"links":{"cited_paper":"/paper/2506.17518","citing_paper":"/paper/2604.09671"},"observation_digest":"sha256:b784e0c6d8cf6c33f47635b20dddc288698d39df2dc7a6990eecdae35dd260ef","observation_id":"563ba66e-ff96-4b01-9e1e-b05806f4cb76","resolution":{"observed_at":"2026-05-13T21:58:19.908240Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2506.17518","last_updated":"2025-06-20T23:47:04Z","snapshot_observed_at":"2026-08-10T10:35:48.301748Z","submitted_at":"2025-06-20T23:47:04Z","title":"A Survey of State Representation Learning for Deep Reinforcement Learning","version":1},"cited_work":{"arxiv_id":"2506.17518","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2506.17518","snapshot_observed_at":"2026-07-04T07:59:40.694649Z","title":"A Survey of State Representation Learning for Deep Reinforcement Learning, June 2025","venue":null,"work_id":"27e3bbd8-8b1c-4b24-9add-ee93fbad104e","year":2025},"citing_paper":{"arxiv_id":"2605.09364","last_updated":"2026-05-10T06:27:20Z","snapshot_observed_at":"2026-08-11T06:51:53.423293Z","submitted_at":"2026-05-10T06:27:20Z","title":"Multi-scale Predictive Representations for Goal-conditioned Reinforcement Learning","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-05-12T03:35:37.739085Z"},"links":{"cited_paper":"/paper/2506.17518","citing_paper":"/paper/2605.09364"},"observation_digest":"sha256:ebb75e7eb2086cc54d8c46f869312f37c438da0404ad1d50133e2a5905583e16","observation_id":"1919587a-f114-488e-a6e2-c5f4923b6f99","resolution":{"observed_at":"2026-05-12T07:16:26.328081Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2506.17518","last_updated":"2025-06-20T23:47:04Z","snapshot_observed_at":"2026-08-10T10:35:48.301748Z","submitted_at":"2025-06-20T23:47:04Z","title":"A Survey of State Representation Learning for Deep Reinforcement Learning","version":1},"cited_work":{"arxiv_id":"2506.17518","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2506.17518","snapshot_observed_at":"2026-07-04T07:59:40.694649Z","title":"A Survey of State Representation Learning for Deep Reinforcement Learning, June 2025","venue":null,"work_id":"27e3bbd8-8b1c-4b24-9add-ee93fbad104e","year":2025},"citing_paper":{"arxiv_id":"2605.22711","last_updated":"2026-05-21T16:50:26Z","snapshot_observed_at":"2026-07-06T23:32:59.663926Z","submitted_at":"2026-05-21T16:50:26Z","title":"Abstraction for Offline Goal-Conditioned Reinforcement Learning","version":1},"reference_index":44,"source":"pdf_text","source_observed_at":"2026-05-22T07:46:20.289421Z"},"links":{"cited_paper":"/paper/2506.17518","citing_paper":"/paper/2605.22711"},"observation_digest":"sha256:c875b9b025ef2877c64ff696ceebcd024a3ab4f4863dcce84e09f645774c2545","observation_id":"6f8e3d58-0158-49b3-bc5a-a4fbcba1d4c5","resolution":{"observed_at":"2026-05-22T07:51:16.511799Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2506.17518","last_updated":"2025-06-20T23:47:04Z","snapshot_observed_at":"2026-08-10T10:35:48.301748Z","submitted_at":"2025-06-20T23:47:04Z","title":"A Survey of State Representation Learning for Deep Reinforcement Learning","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2506.17518","snapshot_observed_at":"2026-07-12T13:42:27.758405Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2606.16933","last_updated":"2026-07-06T13:15:11Z","snapshot_observed_at":"2026-08-13T14:50:51.354464Z","submitted_at":"2026-06-15T16:32:40Z","title":"A Unified Causal-Origin Taxonomy of Distributional Shifts in Reinforcement Learning","version":2},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-07-12T13:42:27.758405Z"},"links":{"cited_paper":"/paper/2506.17518","citing_paper":"/paper/2606.16933"},"observation_digest":"sha256:3105c3b35901e7b8bbfa1725cdf1bf7e5b64315c59efe1ebb9923916d865b4c8","observation_id":"b635bf3c-5141-4366-8881-ccae312cd0f5","resolution":{"observed_at":"2026-07-12T13:42:27.758405Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2506.17518","last_updated":"2025-06-20T23:47:04Z","snapshot_observed_at":"2026-08-10T10:35:48.301748Z","submitted_at":"2025-06-20T23:47:04Z","title":"A Survey of State Representation Learning for Deep Reinforcement Learning","version":1},"cited_work":{"arxiv_id":"2506.17518","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2506.17518","snapshot_observed_at":"2026-07-04T07:59:40.694649Z","title":"A Survey of State Representation Learning for Deep Reinforcement Learning, June 2025","venue":null,"work_id":"27e3bbd8-8b1c-4b24-9add-ee93fbad104e","year":2025},"citing_paper":{"arxiv_id":"2606.21943","last_updated":"2026-06-20T08:20:41Z","snapshot_observed_at":"2026-07-06T23:56:54.959593Z","submitted_at":"2026-06-20T08:20:41Z","title":"Modularized Reinforcement Learning on LLMs: From MDP Creation to Exploration and Learning","version":1},"reference_index":42,"source":"pdf_text","source_observed_at":"2026-06-26T12:15:08.304150Z"},"links":{"cited_paper":"/paper/2506.17518","citing_paper":"/paper/2606.21943"},"observation_digest":"sha256:ae216cb1358b10d8ca2673cee92b03c3de1cf6e8aa4b635bce507ad126817a59","observation_id":"593b92c4-385f-447f-bcf0-ee48330d63b3","resolution":{"observed_at":"2026-07-04T07:59:40.696101Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2506.17518","last_updated":"2025-06-20T23:47:04Z","snapshot_observed_at":"2026-08-10T10:35:48.301748Z","submitted_at":"2025-06-20T23:47:04Z","title":"A Survey of State Representation Learning for Deep Reinforcement Learning","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2506.17518","snapshot_observed_at":"2026-08-12T00:48:43.522343Z","title":"arXiv preprint arXiv:2506.17518 , year=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.07870","last_updated":"2026-08-08T02:44:43Z","snapshot_observed_at":"2026-08-13T23:21:43.490108Z","submitted_at":"2026-08-08T02:44:43Z","title":"V-Simba: Unleashing the Architectural Potential of RL in Visual Continuous Control","version":1},"reference_index":16,"source":"arxiv_source","source_observed_at":"2026-08-12T00:48:43.522343Z"},"links":{"cited_paper":"/paper/2506.17518","citing_paper":"/paper/2608.07870"},"observation_digest":"sha256:cb49a9424abc618262fd052713496b80752bb36b9cc71686d20b7a0472b5cb4e","observation_id":"88367737-f250-4c95-9ced-7c15ca0d2c37","resolution":{"observed_at":"2026-08-12T00:48:43.522343Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"links":{"evidence":"/evidence","html":"/paper/2506.17518/citation-record","integrity":"/paper/2506.17518/integrity","json":"/paper/2506.17518/citation-record.json","paper":"/paper/2506.17518"},"outbound":[{"citation":{"cited_paper":{"arxiv_id":"2203.00397","last_updated":"2022-03-01T12:46:28Z","snapshot_observed_at":"2026-08-13T23:56:48.001977Z","submitted_at":"2022-03-01T12:46:28Z","title":"A Theory of Abstraction in Reinforcement Learning","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2203.00397","snapshot_observed_at":"2026-08-06T23:34:30.715934Z","title":"A theory of abstraction in reinforcement learning","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2506.17518","last_updated":"2025-06-20T23:47:04Z","snapshot_observed_at":"2026-08-10T10:35:48.301748Z","submitted_at":"2025-06-20T23:47:04Z","title":"A Survey of State Representation Learning for Deep Reinforcement Learning","version":1},"reference_index":1,"source":"arxiv_source","source_observed_at":"2026-08-06T23:34:30.715934Z"},"links":{"cited_paper":"/paper/2203.00397","citing_paper":"/paper/2506.17518"},"observation_digest":"sha256:a2ba0e98d5b5dd24d0295a03a90b83228eb7005d11fc488b50cef01ca935a0f7","observation_id":"fc0284af-a214-4ae6-bd9a-17278f658440","resolution":{"observed_at":"2026-08-06T23:34:30.715934Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T23:34:30.807529Z","title":"Machado, Pablo Samuel Castro, and Marc G Bellemare","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2506.17518","last_updated":"2025-06-20T23:47:04Z","snapshot_observed_at":"2026-08-10T10:35:48.301748Z","submitted_at":"2025-06-20T23:47:04Z","title":"A Survey of State Representation Learning for Deep Reinforcement Learning","version":1},"reference_index":2,"source":"arxiv_source","source_observed_at":"2026-08-06T23:34:30.807529Z"},"links":{"citing_paper":"/paper/2506.17518"},"observation_digest":"sha256:09f253c74b71bd269fa0587425c9e27a5653a89f79a1b38a24960aaecd932261","observation_id":"7fbfffcb-2458-40b7-a767-c8b2f8e4502d","resolution":{"observed_at":"2026-08-06T23:34:30.807529Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T23:34:30.950503Z","title":"Bellemare","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2506.17518","last_updated":"2025-06-20T23:47:04Z","snapshot_observed_at":"2026-08-10T10:35:48.301748Z","submitted_at":"2025-06-20T23:47:04Z","title":"A Survey of State Representation Learning for Deep Reinforcement Learning","version":1},"reference_index":3,"source":"arxiv_source","source_observed_at":"2026-08-06T23:34:30.950503Z"},"links":{"citing_paper":"/paper/2506.17518"},"observation_digest":"sha256:067975138d10b1263c98f73c8dfc064c3590d96fe31a09c428afe25c9750a193","observation_id":"70c79a2a-a6f7-400c-8d9c-9cac30786a7d","resolution":{"observed_at":"2026-08-06T23:34:30.950503Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2411.19418","last_updated":"2025-03-11T17:41:54Z","snapshot_observed_at":"2026-08-12T12:08:53.205322Z","submitted_at":"2024-11-29T00:09:39Z","title":"Proto Successor Measure: Representing the Behavior Space of an RL Agent","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2411.19418","snapshot_observed_at":"2026-08-06T23:34:31.066415Z","title":"Proto successor measure: Representing the space of all possible solutions of reinforcement learning, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.17518","last_updated":"2025-06-20T23:47:04Z","snapshot_observed_at":"2026-08-10T10:35:48.301748Z","submitted_at":"2025-06-20T23:47:04Z","title":"A Survey of State Representation Learning for Deep Reinforcement Learning","version":1},"reference_index":4,"source":"arxiv_source","source_observed_at":"2026-08-06T23:34:31.066415Z"},"links":{"cited_paper":"/paper/2411.19418","citing_paper":"/paper/2506.17518"},"observation_digest":"sha256:b8cbbf5b295de2bf4090b2ddd4d4a1691668fd0b7d9f5ac7eefd6e6baf55e582","observation_id":"683c03af-f7ca-44e0-96ef-bbf2d68e1bd0","resolution":{"observed_at":"2026-08-06T23:34:31.066415Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T23:34:31.143480Z","title":"Alemi, Ian Fischer, Joshua V","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2506.17518","last_updated":"2025-06-20T23:47:04Z","snapshot_observed_at":"2026-08-10T10:35:48.301748Z","submitted_at":"2025-06-20T23:47:04Z","title":"A Survey of State Representation Learning for Deep Reinforcement Learning","version":1},"reference_index":5,"source":"arxiv_source","source_observed_at":"2026-08-06T23:34:31.143480Z"},"links":{"citing_paper":"/paper/2506.17518"},"observation_digest":"sha256:ecdb03b0f64d86d7d7e95fbd54ef02e563294d335a7c80d17eeb4352ba20136b","observation_id":"9bebbd1f-1e5a-4262-86dd-9ec8928f9ab0","resolution":{"observed_at":"2026-08-06T23:34:31.143480Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T23:34:31.242705Z","title":"Learning markov state abstractions for deep reinforcement learning","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2506.17518","last_updated":"2025-06-20T23:47:04Z","snapshot_observed_at":"2026-08-10T10:35:48.301748Z","submitted_at":"2025-06-20T23:47:04Z","title":"A Survey of State Representation Learning for Deep Reinforcement Learning","version":1},"reference_index":6,"source":"arxiv_source","source_observed_at":"2026-08-06T23:34:31.242705Z"},"links":{"citing_paper":"/paper/2506.17518"},"observation_digest":"sha256:2799286504ea9dca05ac013613c1a5c299d39a0209f5fda1da3caa82356ebf66","observation_id":"adedad9f-34c0-4fde-b579-135587ad0138","resolution":{"observed_at":"2026-08-06T23:34:31.242705Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T23:34:31.356299Z","title":"A recipe for unbounded data augmentation in visual reinforcement learning","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.17518","last_updated":"2025-06-20T23:47:04Z","snapshot_observed_at":"2026-08-10T10:35:48.301748Z","submitted_at":"2025-06-20T23:47:04Z","title":"A Survey of State Representation Learning for Deep Reinforcement Learning","version":1},"reference_index":7,"source":"arxiv_source","source_observed_at":"2026-08-06T23:34:31.356299Z"},"links":{"citing_paper":"/paper/2506.17518"},"observation_digest":"sha256:140cae77f9b4026e379300ce8568039ff5d2e4fa5d9777c1b34e188f32a9b816","observation_id":"b3b1068e-a4d9-487b-bee4-7c892d5c1c0f","resolution":{"observed_at":"2026-08-06T23:34:31.356299Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1906.08226","last_updated":"2020-11-05T23:10:28Z","snapshot_observed_at":"2026-08-14T16:13:12.694749Z","submitted_at":"2019-06-19T17:16:46Z","title":"Unsupervised State Representation Learning in Atari","version":6},"cited_work":{"arxiv_id":"1906.08226","doi":null,"metadata_source":"pith","pith_arxiv_id":"1906.08226","snapshot_observed_at":"2026-08-06T23:34:50.871053Z","title":"Unsupervised State Representation Learning in Atari","venue":"cs.LG","work_id":"1305721b-6a83-463e-b44d-43897e2a7fff","year":2019},"citing_paper":{"arxiv_id":"2506.17518","last_updated":"2025-06-20T23:47:04Z","snapshot_observed_at":"2026-08-10T10:35:48.301748Z","submitted_at":"2025-06-20T23:47:04Z","title":"A Survey of State Representation Learning for Deep Reinforcement Learning","version":1},"reference_index":8,"source":"arxiv_source","source_observed_at":"2026-08-06T23:34:31.477002Z"},"links":{"cited_paper":"/paper/1906.08226","citing_paper":"/paper/2506.17518"},"observation_digest":"sha256:a119a0fd26fed5b5187b9c176f08fe2f06a556fafe800fb5eef43740cb45a741","observation_id":"ffa5f726-b3d2-4455-a861-9d7d46f2316e","resolution":{"observed_at":"2026-08-06T23:34:51.008715Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T23:34:31.578963Z","title":"Hindsight experience replay","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2506.17518","last_updated":"2025-06-20T23:47:04Z","snapshot_observed_at":"2026-08-10T10:35:48.301748Z","submitted_at":"2025-06-20T23:47:04Z","title":"A Survey of State Representation Learning for Deep Reinforcement Learning","version":1},"reference_index":9,"source":"arxiv_source","source_observed_at":"2026-08-06T23:34:31.578963Z"},"links":{"citing_paper":"/paper/2506.17518"},"observation_digest":"sha256:bd24e6cdbbd96e5c83bb1af1ee335923e2fb0543ef46473bd4d057d455c92a64","observation_id":"1fb18abd-062d-4b92-a5b8-2b513c57520f","resolution":{"observed_at":"2026-08-06T23:34:31.578963Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T23:34:31.654631Z","title":"Self-supervised learning from images with a joint-embedding predictive architecture","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.17518","last_updated":"2025-06-20T23:47:04Z","snapshot_observed_at":"2026-08-10T10:35:48.301748Z","submitted_at":"2025-06-20T23:47:04Z","title":"A Survey of State Representation Learning for Deep Reinforcement Learning","version":1},"reference_index":10,"source":"arxiv_source","source_observed_at":"2026-08-06T23:34:31.654631Z"},"links":{"citing_paper":"/paper/2506.17518"},"observation_digest":"sha256:744f6413cb2a344719d6d2c841cd6132dffb6acb250b737c69424dd533e2a781","observation_id":"40eb1f6f-2920-43d9-a758-ecf0e3cb527f","resolution":{"observed_at":"2026-08-06T23:34:31.654631Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1409.0473","last_updated":"2016-05-19T21:53:22Z","snapshot_observed_at":"2026-08-12T12:07:33.202888Z","submitted_at":"2014-09-01T16:33:02Z","title":"Neural Machine Translation by Jointly Learning to Align and Translate","version":7},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1409.0473","snapshot_observed_at":"2026-08-06T23:34:31.744229Z","title":"Neural machine translation by jointly learning to align and translate","venue":null,"work_id":null,"year":2015},"citing_paper":{"arxiv_id":"2506.17518","last_updated":"2025-06-20T23:47:04Z","snapshot_observed_at":"2026-08-10T10:35:48.301748Z","submitted_at":"2025-06-20T23:47:04Z","title":"A Survey of State Representation Learning for Deep Reinforcement Learning","version":1},"reference_index":11,"source":"arxiv_source","source_observed_at":"2026-08-06T23:34:31.744229Z"},"links":{"cited_paper":"/paper/1409.0473","citing_paper":"/paper/2506.17518"},"observation_digest":"sha256:4bc967b18d2168960bfcb33fa1f79e79aee79a6d8a589e5b58587c5b4ec88d98","observation_id":"9f2277d9-3556-4ae1-904b-9a1fe1c9f621","resolution":{"observed_at":"2026-08-06T23:34:31.744229Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2105.04906","last_updated":"2022-01-28T12:23:37Z","snapshot_observed_at":"2026-08-12T14:02:29.797842Z","submitted_at":"2021-05-11T09:53:21Z","title":"VICReg: Variance-Invariance-Covariance Regularization for Self-Supervised Learning","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2105.04906","snapshot_observed_at":"2026-08-06T23:34:31.814504Z","title":"Vicreg: Variance-invariance-covariance regularization for self-supervised learning","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2506.17518","last_updated":"2025-06-20T23:47:04Z","snapshot_observed_at":"2026-08-10T10:35:48.301748Z","submitted_at":"2025-06-20T23:47:04Z","title":"A Survey of State Representation Learning for Deep Reinforcement Learning","version":1},"reference_index":12,"source":"arxiv_source","source_observed_at":"2026-08-06T23:34:31.814504Z"},"links":{"cited_paper":"/paper/2105.04906","citing_paper":"/paper/2506.17518"},"observation_digest":"sha256:731439bd8271927c13aaa27cd92629de57557729d2d6550cd4e6daab6d0eb66d","observation_id":"b52123de-b84a-4f66-bcd7-9f470184f823","resolution":{"observed_at":"2026-08-06T23:34:31.814504Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2302.05342","last_updated":"2024-06-26T13:28:35Z","snapshot_observed_at":"2026-08-14T03:43:27.894886Z","submitted_at":"2023-02-10T15:57:20Z","title":"Combining Reconstruction and Contrastive Methods for Multimodal Representations in RL","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2302.05342","snapshot_observed_at":"2026-08-06T23:34:31.865871Z","title":"Combining reconstruction and contrastive methods for multimodal representations in rl, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.17518","last_updated":"2025-06-20T23:47:04Z","snapshot_observed_at":"2026-08-10T10:35:48.301748Z","submitted_at":"2025-06-20T23:47:04Z","title":"A Survey of State Representation Learning for Deep Reinforcement Learning","version":1},"reference_index":13,"source":"arxiv_source","source_observed_at":"2026-08-06T23:34:31.865871Z"},"links":{"cited_paper":"/paper/2302.05342","citing_paper":"/paper/2506.17518"},"observation_digest":"sha256:53f4d0d802d8339c101bab17c40e54f5f7c72d712d9f8d01698d276d57681d34","observation_id":"c6e9439b-652b-4a2f-9c31-bc0b655ce9d1","resolution":{"observed_at":"2026-08-06T23:34:31.865871Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T23:34:31.975014Z","title":"The arcade learning environment: An evaluation platform for general agents","venue":null,"work_id":null,"year":2013},"citing_paper":{"arxiv_id":"2506.17518","last_updated":"2025-06-20T23:47:04Z","snapshot_observed_at":"2026-08-10T10:35:48.301748Z","submitted_at":"2025-06-20T23:47:04Z","title":"A Survey of State Representation Learning for Deep Reinforcement Learning","version":1},"reference_index":14,"source":"arxiv_source","source_observed_at":"2026-08-06T23:34:31.975014Z"},"links":{"citing_paper":"/paper/2506.17518"},"observation_digest":"sha256:5747690cb1bd727de579979d71e1b363b17fd3450bfe6ebd5d4664a89b3f3ba1","observation_id":"e00709d0-3b7e-4178-bb9a-6bc6f9229e38","resolution":{"observed_at":"2026-08-06T23:34:31.975014Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1206.5538","last_updated":"2014-04-23T11:48:51Z","snapshot_observed_at":"2026-08-15T00:55:35.699171Z","submitted_at":"2012-06-24T20:51:38Z","title":"Representation Learning: A Review and New Perspectives","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1206.5538","snapshot_observed_at":"2026-08-06T23:34:32.042792Z","title":"Courville, and Pascal Vincent","venue":null,"work_id":null,"year":2012},"citing_paper":{"arxiv_id":"2506.17518","last_updated":"2025-06-20T23:47:04Z","snapshot_observed_at":"2026-08-10T10:35:48.301748Z","submitted_at":"2025-06-20T23:47:04Z","title":"A Survey of State Representation Learning for Deep Reinforcement Learning","version":1},"reference_index":15,"source":"arxiv_source","source_observed_at":"2026-08-06T23:34:32.042792Z"},"links":{"cited_paper":"/paper/1206.5538","citing_paper":"/paper/2506.17518"},"observation_digest":"sha256:5866620e970dae0e24fe93c0645324d9a78bc9a430c426a1f6048a857f7fc313","observation_id":"227c9b5b-29aa-4cf5-ba90-48338c9f003b","resolution":{"observed_at":"2026-08-06T23:34:32.042792Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T23:34:32.123012Z","title":"Look where you look! saliency-guided q-networks for generalization in visual reinforcement learning","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2506.17518","last_updated":"2025-06-20T23:47:04Z","snapshot_observed_at":"2026-08-10T10:35:48.301748Z","submitted_at":"2025-06-20T23:47:04Z","title":"A Survey of State Representation Learning for Deep Reinforcement Learning","version":1},"reference_index":16,"source":"arxiv_source","source_observed_at":"2026-08-06T23:34:32.123012Z"},"links":{"citing_paper":"/paper/2506.17518"},"observation_digest":"sha256:dc2475c20307fe5b6574a8d8eacce01dcc5e233536565b09607264a8eebce93e","observation_id":"13381cb8-049f-4314-8761-03712ff125be","resolution":{"observed_at":"2026-08-06T23:34:32.123012Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T23:34:32.207951Z","title":"Riedmiller, and Klaus Obermayer","venue":null,"work_id":null,"year":2015},"citing_paper":{"arxiv_id":"2506.17518","last_updated":"2025-06-20T23:47:04Z","snapshot_observed_at":"2026-08-10T10:35:48.301748Z","submitted_at":"2025-06-20T23:47:04Z","title":"A Survey of State Representation Learning for Deep Reinforcement Learning","version":1},"reference_index":17,"source":"arxiv_source","source_observed_at":"2026-08-06T23:34:32.207951Z"},"links":{"citing_paper":"/paper/2506.17518"},"observation_digest":"sha256:667dfa077fdb6b0ab564b5050958c2e93d1d7b5437c39815006bbd914f8d18d6","observation_id":"6a57f70d-d1ec-4662-ab92-de6fed824494","resolution":{"observed_at":"2026-08-06T23:34:32.207951Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2208.14226","last_updated":"2024-05-01T13:00:39Z","snapshot_observed_at":"2026-08-13T14:38:06.099089Z","submitted_at":"2022-08-27T09:38:56Z","title":"Unsupervised Representation Learning in Deep Reinforcement Learning: A Review","version":3},"cited_work":{"arxiv_id":"2208.14226","doi":null,"metadata_source":"pith","pith_arxiv_id":"2208.14226","snapshot_observed_at":"2026-08-06T23:34:50.666018Z","title":"Unsupervised Representation Learning in Deep Reinforcement Learning: A Review","venue":"cs.LG","work_id":"7e3eca1e-4abc-41ae-b6e7-61e04cd8108b","year":2022},"citing_paper":{"arxiv_id":"2506.17518","last_updated":"2025-06-20T23:47:04Z","snapshot_observed_at":"2026-08-10T10:35:48.301748Z","submitted_at":"2025-06-20T23:47:04Z","title":"A Survey of State Representation Learning for Deep Reinforcement Learning","version":1},"reference_index":18,"source":"arxiv_source","source_observed_at":"2026-08-06T23:34:32.317937Z"},"links":{"cited_paper":"/paper/2208.14226","citing_paper":"/paper/2506.17518"},"observation_digest":"sha256:d6677038217481f0b1c140a888d04e3f7a07eef1c445bfa9b8aaed526fba476a","observation_id":"2619fb39-ead0-4c0b-8f64-469fe06d1997","resolution":{"observed_at":"2026-08-06T23:34:50.746395Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T23:34:32.420685Z","title":"Barlowrl: Barlow twins for data-efficient reinforcement learning, 2023","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.17518","last_updated":"2025-06-20T23:47:04Z","snapshot_observed_at":"2026-08-10T10:35:48.301748Z","submitted_at":"2025-06-20T23:47:04Z","title":"A Survey of State Representation Learning for Deep Reinforcement Learning","version":1},"reference_index":19,"source":"arxiv_source","source_observed_at":"2026-08-06T23:34:32.420685Z"},"links":{"citing_paper":"/paper/2506.17518"},"observation_digest":"sha256:ca82667442d74d5c630b9ece0ea2415fc34a60b329fd8b57a5aabd407cd5fa49","observation_id":"56feb069-faba-436e-8b84-adafa5f7a471","resolution":{"observed_at":"2026-08-06T23:34:32.420685Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T23:34:32.562977Z","title":"Scalable methods for computing state similarity in deterministic markov decision processes","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2506.17518","last_updated":"2025-06-20T23:47:04Z","snapshot_observed_at":"2026-08-10T10:35:48.301748Z","submitted_at":"2025-06-20T23:47:04Z","title":"A Survey of State Representation Learning for Deep Reinforcement Learning","version":1},"reference_index":20,"source":"arxiv_source","source_observed_at":"2026-08-06T23:34:32.562977Z"},"links":{"citing_paper":"/paper/2506.17518"},"observation_digest":"sha256:d34bf53b7412256d189da31302d7f31ae5377b6d2cdf403780a27a52f153bb1e","observation_id":"2c7a5e28-6427-413e-8fa0-4eecf71701f8","resolution":{"observed_at":"2026-08-06T23:34:32.562977Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T23:34:32.724712Z","title":"MIC o: Improved representations via sampling-based state similarity for markov decision processes","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2506.17518","last_updated":"2025-06-20T23:47:04Z","snapshot_observed_at":"2026-08-10T10:35:48.301748Z","submitted_at":"2025-06-20T23:47:04Z","title":"A Survey of State Representation Learning for Deep Reinforcement Learning","version":1},"reference_index":21,"source":"arxiv_source","source_observed_at":"2026-08-06T23:34:32.724712Z"},"links":{"citing_paper":"/paper/2506.17518"},"observation_digest":"sha256:8afb13f3429d46d8fc6ac49b6a1a4f40041af39a54db5db7b7aa520fc3a0701c","observation_id":"ad3d8022-57be-4282-8bb6-a97501533644","resolution":{"observed_at":"2026-08-06T23:34:32.724712Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T23:34:32.803959Z","title":"Learning action representations for reinforcement learning","venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2506.17518","last_updated":"2025-06-20T23:47:04Z","snapshot_observed_at":"2026-08-10T10:35:48.301748Z","submitted_at":"2025-06-20T23:47:04Z","title":"A Survey of State Representation Learning for Deep Reinforcement Learning","version":1},"reference_index":22,"source":"arxiv_source","source_observed_at":"2026-08-06T23:34:32.803959Z"},"links":{"citing_paper":"/paper/2506.17518"},"observation_digest":"sha256:4fc3ff63ce894f5010645900c62167cbee340eebf8da274bfe96634aba395f95","observation_id":"0e012f29-b1e3-4c92-8aa2-ab8664145258","resolution":{"observed_at":"2026-08-06T23:34:32.803959Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T23:34:32.914761Z","title":"Why do we need large batchsizes in contrastive learning? a gradient-bias perspective","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2506.17518","last_updated":"2025-06-20T23:47:04Z","snapshot_observed_at":"2026-08-10T10:35:48.301748Z","submitted_at":"2025-06-20T23:47:04Z","title":"A Survey of State Representation Learning for Deep Reinforcement Learning","version":1},"reference_index":23,"source":"arxiv_source","source_observed_at":"2026-08-06T23:34:32.914761Z"},"links":{"citing_paper":"/paper/2506.17518"},"observation_digest":"sha256:6a0dc36028824eef4ed2d322830236726b245e04a3577b8cc6ad83e102f19dc5","observation_id":"92d5298a-6545-475a-8464-58e8249438eb","resolution":{"observed_at":"2026-08-06T23:34:32.914761Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T23:34:33.016166Z","title":"Focus-then-decide: Segmentation-assisted reinforcement learning","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.17518","last_updated":"2025-06-20T23:47:04Z","snapshot_observed_at":"2026-08-10T10:35:48.301748Z","submitted_at":"2025-06-20T23:47:04Z","title":"A Survey of State Representation Learning for Deep Reinforcement Learning","version":1},"reference_index":24,"source":"arxiv_source","source_observed_at":"2026-08-06T23:34:33.016166Z"},"links":{"citing_paper":"/paper/2506.17518"},"observation_digest":"sha256:2c114f02cbad0d2d36fc13a6342268095534fb16d1d0408ca486b30b197502fe","observation_id":"e48246f5-0fa4-4c5d-97f8-e4df61955af3","resolution":{"observed_at":"2026-08-06T23:34:33.016166Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T23:34:33.152839Z","title":"Learning representations via a robust behavioral metric for deep reinforcement learning","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2506.17518","last_updated":"2025-06-20T23:47:04Z","snapshot_observed_at":"2026-08-10T10:35:48.301748Z","submitted_at":"2025-06-20T23:47:04Z","title":"A Survey of State Representation Learning for Deep Reinforcement Learning","version":1},"reference_index":25,"source":"arxiv_source","source_observed_at":"2026-08-06T23:34:33.152839Z"},"links":{"citing_paper":"/paper/2506.17518"},"observation_digest":"sha256:0baa00fc25a3a09cb49e4275e27b28d9ef2e464694581a5f2375cdf8114470fb","observation_id":"dade7f15-f3f4-494a-ab8b-70f658e21596","resolution":{"observed_at":"2026-08-06T23:34:33.152839Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T23:34:33.337965Z","title":"State chrono representation for enhancing generalization in reinforcement learning","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.17518","last_updated":"2025-06-20T23:47:04Z","snapshot_observed_at":"2026-08-10T10:35:48.301748Z","submitted_at":"2025-06-20T23:47:04Z","title":"A Survey of State Representation Learning for Deep Reinforcement Learning","version":1},"reference_index":26,"source":"arxiv_source","source_observed_at":"2026-08-06T23:34:33.337965Z"},"links":{"citing_paper":"/paper/2506.17518"},"observation_digest":"sha256:f5bbe3027057dd7c733a91dd9edd5dc09130958704217cd5e2df703b7958d412","observation_id":"e44909d6-4cad-49b3-b706-f5a7fc74aa5e","resolution":{"observed_at":"2026-08-06T23:34:33.337965Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2402.02651","last_updated":"2024-05-23T01:04:11Z","snapshot_observed_at":"2026-08-13T04:27:10.738262Z","submitted_at":"2024-02-05T00:48:56Z","title":"Vision-Language Models Provide Promptable Representations for Reinforcement Learning","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.02651","snapshot_observed_at":"2026-08-06T23:34:33.529555Z","title":"Vision-language models provide promptable representations for reinforcement learning, 2024 c","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.17518","last_updated":"2025-06-20T23:47:04Z","snapshot_observed_at":"2026-08-10T10:35:48.301748Z","submitted_at":"2025-06-20T23:47:04Z","title":"A Survey of State Representation Learning for Deep Reinforcement Learning","version":1},"reference_index":27,"source":"arxiv_source","source_observed_at":"2026-08-06T23:34:33.529555Z"},"links":{"cited_paper":"/paper/2402.02651","citing_paper":"/paper/2506.17518"},"observation_digest":"sha256:cef5c7583e8b7a558c179698864deee21cefb05c67fe979d0226a1d8bdf29d49","observation_id":"4aa79829-9bce-4be4-b816-064769238ad5","resolution":{"observed_at":"2026-08-06T23:34:33.529555Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T23:34:33.656564Z","title":"Exploring simple siamese representation learning","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2506.17518","last_updated":"2025-06-20T23:47:04Z","snapshot_observed_at":"2026-08-10T10:35:48.301748Z","submitted_at":"2025-06-20T23:47:04Z","title":"A Survey of State Representation Learning for Deep Reinforcement Learning","version":1},"reference_index":28,"source":"arxiv_source","source_observed_at":"2026-08-06T23:34:33.656564Z"},"links":{"citing_paper":"/paper/2506.17518"},"observation_digest":"sha256:31e0da02443689e9bbd5d7e4ed28978ed39c8145962c37ece3d20619a19eca54","observation_id":"1974af94-c7bb-43b1-9a62-fe563ec95f7c","resolution":{"observed_at":"2026-08-06T23:34:33.656564Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T23:34:33.732315Z","title":"Mudalige, Katharina Muelling, and John M","venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2506.17518","last_updated":"2025-06-20T23:47:04Z","snapshot_observed_at":"2026-08-10T10:35:48.301748Z","submitted_at":"2025-06-20T23:47:04Z","title":"A Survey of State Representation Learning for Deep Reinforcement Learning","version":1},"reference_index":29,"source":"arxiv_source","source_observed_at":"2026-08-06T23:34:33.732315Z"},"links":{"citing_paper":"/paper/2506.17518"},"observation_digest":"sha256:00c6da4e6130571c23ab8c5d9cb6a6bb1ab9541e87229d6d8939d4c68680bbb3","observation_id":"248f4eb1-ed0f-4dd6-b78a-e9817ccd050c","resolution":{"observed_at":"2026-08-06T23:34:33.732315Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T23:34:33.846466Z","title":"Provable benefit of multitask representation learning in reinforcement learning","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2506.17518","last_updated":"2025-06-20T23:47:04Z","snapshot_observed_at":"2026-08-10T10:35:48.301748Z","submitted_at":"2025-06-20T23:47:04Z","title":"A Survey of State Representation Learning for Deep Reinforcement Learning","version":1},"reference_index":30,"source":"arxiv_source","source_observed_at":"2026-08-06T23:34:33.846466Z"},"links":{"citing_paper":"/paper/2506.17518"},"observation_digest":"sha256:8109ed838911c12413cfc736550cd5b8a11d698a6cc60cb631b630a5e2a3a71d","observation_id":"1be9d304-2034-4e27-b33d-6304a32383e7","resolution":{"observed_at":"2026-08-06T23:34:33.846466Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T23:34:33.966441Z","title":"Improving generalisation for temporal difference learning: The successor representation","venue":null,"work_id":null,"year":1993},"citing_paper":{"arxiv_id":"2506.17518","last_updated":"2025-06-20T23:47:04Z","snapshot_observed_at":"2026-08-10T10:35:48.301748Z","submitted_at":"2025-06-20T23:47:04Z","title":"A Survey of State Representation Learning for Deep Reinforcement Learning","version":1},"reference_index":31,"source":"arxiv_source","source_observed_at":"2026-08-06T23:34:33.966441Z"},"links":{"citing_paper":"/paper/2506.17518"},"observation_digest":"sha256:aac6c9e08fbdf5d60c983a85d5e01b6e59a22b59cbcc4288550d22576e189c27","observation_id":"a3185252-2ef7-4eca-a1e5-0787cbf31e40","resolution":{"observed_at":"2026-08-06T23:34:33.966441Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T23:34:34.093588Z","title":"Integrating state representation learning into deep reinforcement learning","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2506.17518","last_updated":"2025-06-20T23:47:04Z","snapshot_observed_at":"2026-08-10T10:35:48.301748Z","submitted_at":"2025-06-20T23:47:04Z","title":"A Survey of State Representation Learning for Deep Reinforcement Learning","version":1},"reference_index":32,"source":"arxiv_source","source_observed_at":"2026-08-06T23:34:34.093588Z"},"links":{"citing_paper":"/paper/2506.17518"},"observation_digest":"sha256:629a3873a7ea399d714e1dcf2e0b44fc28f89ab2ff9a11bf3f002cf278a88f28","observation_id":"249a0d35-e33f-40b8-b04b-c598d219ce36","resolution":{"observed_at":"2026-08-06T23:34:34.093588Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2406.16468","last_updated":"2024-06-24T09:16:59Z","snapshot_observed_at":"2026-08-12T23:36:18.793535Z","submitted_at":"2024-06-24T09:16:59Z","title":"The Hidden Pitfalls of the Cosine Similarity Loss","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2406.16468","snapshot_observed_at":"2026-08-06T23:34:34.199169Z","title":"The hidden pitfalls of the cosine similarity loss","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.17518","last_updated":"2025-06-20T23:47:04Z","snapshot_observed_at":"2026-08-10T10:35:48.301748Z","submitted_at":"2025-06-20T23:47:04Z","title":"A Survey of State Representation Learning for Deep Reinforcement Learning","version":1},"reference_index":33,"source":"arxiv_source","source_observed_at":"2026-08-06T23:34:34.199169Z"},"links":{"cited_paper":"/paper/2406.16468","citing_paper":"/paper/2506.17518"},"observation_digest":"sha256:6f659d470c186c131d3db18f628089ad5e7690ce1ec72b9db0a5173573c52f23","observation_id":"247d2adb-97eb-4705-a285-04f5296570b4","resolution":{"observed_at":"2026-08-06T23:34:34.199169Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T23:34:34.296516Z","title":"Provably efficient rl with rich observations via latent state decoding","venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2506.17518","last_updated":"2025-06-20T23:47:04Z","snapshot_observed_at":"2026-08-10T10:35:48.301748Z","submitted_at":"2025-06-20T23:47:04Z","title":"A Survey of State Representation Learning for Deep Reinforcement Learning","version":1},"reference_index":34,"source":"arxiv_source","source_observed_at":"2026-08-06T23:34:34.296516Z"},"links":{"citing_paper":"/paper/2506.17518"},"observation_digest":"sha256:fc5f058ae586eef607bc8fc23b80b0f0b2fa0fad7c79b85a052f4e2e5dbe35f9","observation_id":"0ea8e572-ee52-4b48-b4ea-934b237d19fc","resolution":{"observed_at":"2026-08-06T23:34:34.296516Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1812.02224","last_updated":"2020-11-25T19:33:00Z","snapshot_observed_at":"2026-08-14T17:47:51.883746Z","submitted_at":"2018-12-05T21:00:44Z","title":"Adapting Auxiliary Losses Using Gradient Similarity","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1812.02224","snapshot_observed_at":"2026-08-06T23:34:34.373838Z","title":"Czarnecki, Siddhant M","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2506.17518","last_updated":"2025-06-20T23:47:04Z","snapshot_observed_at":"2026-08-10T10:35:48.301748Z","submitted_at":"2025-06-20T23:47:04Z","title":"A Survey of State Representation Learning for Deep Reinforcement Learning","version":1},"reference_index":35,"source":"arxiv_source","source_observed_at":"2026-08-06T23:34:34.373838Z"},"links":{"cited_paper":"/paper/1812.02224","citing_paper":"/paper/2506.17518"},"observation_digest":"sha256:78a5d533c7a426c74ddc005bd7712b1797a59f2d7cbd584b69cf35068032dd7a","observation_id":"52d1e052-1648-407e-a701-f30c4224a965","resolution":{"observed_at":"2026-08-06T23:34:34.373838Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T23:34:34.475817Z","title":"Multi-view disentanglement for reinforcement learning with multiple cameras","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.17518","last_updated":"2025-06-20T23:47:04Z","snapshot_observed_at":"2026-08-10T10:35:48.301748Z","submitted_at":"2025-06-20T23:47:04Z","title":"A Survey of State Representation Learning for Deep Reinforcement Learning","version":1},"reference_index":36,"source":"arxiv_source","source_observed_at":"2026-08-06T23:34:34.475817Z"},"links":{"citing_paper":"/paper/2506.17518"},"observation_digest":"sha256:18e65231f52ae5496d816c07ba800647151e92f90e4d8d1553168332a377100f","observation_id":"5e7ef77a-933e-402d-b3a3-f772ddcd6f7b","resolution":{"observed_at":"2026-08-06T23:34:34.475817Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T23:34:34.560683Z","title":"Hanna, and Stefano V Albrecht","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.17518","last_updated":"2025-06-20T23:47:04Z","snapshot_observed_at":"2026-08-10T10:35:48.301748Z","submitted_at":"2025-06-20T23:47:04Z","title":"A Survey of State Representation Learning for Deep Reinforcement Learning","version":1},"reference_index":37,"source":"arxiv_source","source_observed_at":"2026-08-06T23:34:34.560683Z"},"links":{"citing_paper":"/paper/2506.17518"},"observation_digest":"sha256:d4d97d74737cf4ec2ff9b82b3e54e00169981af5ccb20011e508aa4065607e08","observation_id":"5f7a9eeb-dcbe-4932-94c2-e03269cefae5","resolution":{"observed_at":"2026-08-06T23:34:34.560683Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T23:34:34.640892Z","title":"Conditional mutual information for disentangled representations in reinforcement learning","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.17518","last_updated":"2025-06-20T23:47:04Z","snapshot_observed_at":"2026-08-10T10:35:48.301748Z","submitted_at":"2025-06-20T23:47:04Z","title":"A Survey of State Representation Learning for Deep Reinforcement Learning","version":1},"reference_index":38,"source":"arxiv_source","source_observed_at":"2026-08-06T23:34:34.640892Z"},"links":{"citing_paper":"/paper/2506.17518"},"observation_digest":"sha256:e89adc9b024b84c9ec8c6f5a34fc11a8109e625eca8ce3023d019dd542afbca4","observation_id":"0aafa79e-c019-4a88-bc8d-f0c2c87e6696","resolution":{"observed_at":"2026-08-06T23:34:34.640892Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T23:34:34.789507Z","title":"Provable benefits of representational transfer in reinforcement learning","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2506.17518","last_updated":"2025-06-20T23:47:04Z","snapshot_observed_at":"2026-08-10T10:35:48.301748Z","submitted_at":"2025-06-20T23:47:04Z","title":"A Survey of State Representation Learning for Deep Reinforcement Learning","version":1},"reference_index":39,"source":"arxiv_source","source_observed_at":"2026-08-06T23:34:34.789507Z"},"links":{"citing_paper":"/paper/2506.17518"},"observation_digest":"sha256:ef49ecb4a30b3fd62db93d5590c9fbec5c59b9787124d4b27f511736ff979df0","observation_id":"769176f0-4365-4a03-aa81-988eafb6751e","resolution":{"observed_at":"2026-08-06T23:34:34.789507Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T23:34:34.959646Z","title":"Dribo: Robust deep reinforcement learning via multi-view information bottleneck","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2506.17518","last_updated":"2025-06-20T23:47:04Z","snapshot_observed_at":"2026-08-10T10:35:48.301748Z","submitted_at":"2025-06-20T23:47:04Z","title":"A Survey of State Representation Learning for Deep Reinforcement Learning","version":1},"reference_index":40,"source":"arxiv_source","source_observed_at":"2026-08-06T23:34:34.959646Z"},"links":{"citing_paper":"/paper/2506.17518"},"observation_digest":"sha256:fe59ef7234ec4080c49ff661faf1d1124f18d57c19187f27bfc8191479295ab2","observation_id":"7dae1c0f-864c-4e9e-99d9-c9d633a39f6c","resolution":{"observed_at":"2026-08-06T23:34:34.959646Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2304.12567","last_updated":"2023-04-25T04:25:08Z","snapshot_observed_at":"2026-08-13T11:55:46.266787Z","submitted_at":"2023-04-25T04:25:08Z","title":"Proto-Value Networks: Scaling Representation Learning with Auxiliary Tasks","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2304.12567","snapshot_observed_at":"2026-08-06T23:34:35.083341Z","title":"Bellemare","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.17518","last_updated":"2025-06-20T23:47:04Z","snapshot_observed_at":"2026-08-10T10:35:48.301748Z","submitted_at":"2025-06-20T23:47:04Z","title":"A Survey of State Representation Learning for Deep Reinforcement Learning","version":1},"reference_index":41,"source":"arxiv_source","source_observed_at":"2026-08-06T23:34:35.083341Z"},"links":{"cited_paper":"/paper/2304.12567","citing_paper":"/paper/2506.17518"},"observation_digest":"sha256:c1207837a13bf753dd9781d02727b21865ba81dd0668de2ba71c08e60f291d37","observation_id":"ec63ff41-2aec-4ab2-97a1-0e9ff0cbbfad","resolution":{"observed_at":"2026-08-06T23:34:35.083341Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1902.06865","last_updated":"2019-02-28T18:32:24Z","snapshot_observed_at":"2026-08-14T17:14:38.454793Z","submitted_at":"2019-02-19T02:36:14Z","title":"Hyperbolic Discounting and Learning over Multiple Horizons","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1902.06865","snapshot_observed_at":"2026-08-06T23:34:35.200811Z","title":"Hyperbolic discounting and learning over multiple horizons","venue":null,"work_id":null,"year":1902},"citing_paper":{"arxiv_id":"2506.17518","last_updated":"2025-06-20T23:47:04Z","snapshot_observed_at":"2026-08-10T10:35:48.301748Z","submitted_at":"2025-06-20T23:47:04Z","title":"A Survey of State Representation Learning for Deep Reinforcement Learning","version":1},"reference_index":42,"source":"arxiv_source","source_observed_at":"2026-08-06T23:34:35.200811Z"},"links":{"cited_paper":"/paper/1902.06865","citing_paper":"/paper/2506.17518"},"observation_digest":"sha256:67803d37e6c4e74320cb2e6a001a4e9fdff80906a315993495c7541b0260392d","observation_id":"52ea7c01-1655-40b0-88f1-910a0bd89cf5","resolution":{"observed_at":"2026-08-06T23:34:35.200811Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1207.4114","last_updated":"2012-07-11T14:43:04Z","snapshot_observed_at":"2026-08-15T00:53:38.690179Z","submitted_at":"2012-07-11T14:43:04Z","title":"Metrics for Finite Markov Decision Processes","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1207.4114","snapshot_observed_at":"2026-08-06T23:34:35.347118Z","title":"Metrics for finite markov decision processes","venue":null,"work_id":null,"year":2012},"citing_paper":{"arxiv_id":"2506.17518","last_updated":"2025-06-20T23:47:04Z","snapshot_observed_at":"2026-08-10T10:35:48.301748Z","submitted_at":"2025-06-20T23:47:04Z","title":"A Survey of State Representation Learning for Deep Reinforcement Learning","version":1},"reference_index":43,"source":"arxiv_source","source_observed_at":"2026-08-06T23:34:35.347118Z"},"links":{"cited_paper":"/paper/1207.4114","citing_paper":"/paper/2506.17518"},"observation_digest":"sha256:0e5576a598daafc32628db863277f4957f806a67c8e99e46643f9e62fdb92905","observation_id":"0d3781db-7163-44f7-93ae-c881c3318f8a","resolution":{"observed_at":"2026-08-06T23:34:35.347118Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1901.00943","last_updated":"2019-01-03T23:49:09Z","snapshot_observed_at":"2026-08-14T17:35:21.204750Z","submitted_at":"2019-01-03T23:49:09Z","title":"Self-supervised Learning of Image Embedding for Continuous Control","version":1},"cited_work":{"arxiv_id":"1901.00943","doi":null,"metadata_source":"pith","pith_arxiv_id":"1901.00943","snapshot_observed_at":"2026-08-06T23:34:50.406214Z","title":"Self-supervised Learning of Image Embedding for Continuous Control","venue":"cs.LG","work_id":"c085693b-022d-486d-a500-6f4b82527b17","year":2019},"citing_paper":{"arxiv_id":"2506.17518","last_updated":"2025-06-20T23:47:04Z","snapshot_observed_at":"2026-08-10T10:35:48.301748Z","submitted_at":"2025-06-20T23:47:04Z","title":"A Survey of State Representation Learning for Deep Reinforcement Learning","version":1},"reference_index":44,"source":"arxiv_source","source_observed_at":"2026-08-06T23:34:35.455306Z"},"links":{"cited_paper":"/paper/1901.00943","citing_paper":"/paper/2506.17518"},"observation_digest":"sha256:d1e7e5403d67853edfef927add0292123720b99fb9595f3acff866e017e68457","observation_id":"247920c0-a5e6-420c-a29b-e68af30476d1","resolution":{"observed_at":"2026-08-06T23:34:50.432408Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T23:34:35.531471Z","title":"For sale: State-action representation learning for deep reinforcement learning","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.17518","last_updated":"2025-06-20T23:47:04Z","snapshot_observed_at":"2026-08-10T10:35:48.301748Z","submitted_at":"2025-06-20T23:47:04Z","title":"A Survey of State Representation Learning for Deep Reinforcement Learning","version":1},"reference_index":45,"source":"arxiv_source","source_observed_at":"2026-08-06T23:34:35.531471Z"},"links":{"citing_paper":"/paper/2506.17518"},"observation_digest":"sha256:4cae72d4b7492ef6f60e9101b56210c3862b674578ab5fa3bfcae7f7f8a4e433","observation_id":"0245ae6f-8232-4548-b34a-61184b23c1d9","resolution":{"observed_at":"2026-08-06T23:34:35.531471Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2501.16142","last_updated":"2025-01-27T15:36:37Z","snapshot_observed_at":"2026-08-12T13:31:12.701489Z","submitted_at":"2025-01-27T15:36:37Z","title":"Towards General-Purpose Model-Free Reinforcement Learning","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2501.16142","snapshot_observed_at":"2026-08-06T23:34:35.620176Z","title":"Towards general-purpose model-free reinforcement learning, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2506.17518","last_updated":"2025-06-20T23:47:04Z","snapshot_observed_at":"2026-08-10T10:35:48.301748Z","submitted_at":"2025-06-20T23:47:04Z","title":"A Survey of State Representation Learning for Deep Reinforcement Learning","version":1},"reference_index":46,"source":"arxiv_source","source_observed_at":"2026-08-06T23:34:35.620176Z"},"links":{"cited_paper":"/paper/2501.16142","citing_paper":"/paper/2506.17518"},"observation_digest":"sha256:251089084eff92bcf9f9c77b2fe6d385ae549449dca34f4de0b44519ef7630a5","observation_id":"d4b0f8b5-cc20-45b9-bed2-1406b5bfb2b8","resolution":{"observed_at":"2026-08-06T23:34:35.620176Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T23:34:35.673088Z","title":"Rankme: Assessing the downstream performance of pretrained self-supervised representations by their rank","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.17518","last_updated":"2025-06-20T23:47:04Z","snapshot_observed_at":"2026-08-10T10:35:48.301748Z","submitted_at":"2025-06-20T23:47:04Z","title":"A Survey of State Representation Learning for Deep Reinforcement Learning","version":1},"reference_index":47,"source":"arxiv_source","source_observed_at":"2026-08-06T23:34:35.673088Z"},"links":{"citing_paper":"/paper/2506.17518"},"observation_digest":"sha256:90eb4d616b2110b3e0b3f1ad9f67c6fe8c9343d3b05b8880e10dea3b30545714","observation_id":"3d2ecb1d-08cd-4a12-a7b2-92a45a182603","resolution":{"observed_at":"2026-08-06T23:34:35.673088Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2403.00504","last_updated":"2024-03-01T13:05:38Z","snapshot_observed_at":"2026-08-14T07:42:12.869054Z","submitted_at":"2024-03-01T13:05:38Z","title":"Learning and Leveraging World Models in Visual Representation Learning","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2403.00504","snapshot_observed_at":"2026-08-06T23:34:35.739408Z","title":"Learning and leveraging world models in visual representation learning","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.17518","last_updated":"2025-06-20T23:47:04Z","snapshot_observed_at":"2026-08-10T10:35:48.301748Z","submitted_at":"2025-06-20T23:47:04Z","title":"A Survey of State Representation Learning for Deep Reinforcement Learning","version":1},"reference_index":48,"source":"arxiv_source","source_observed_at":"2026-08-06T23:34:35.739408Z"},"links":{"cited_paper":"/paper/2403.00504","citing_paper":"/paper/2506.17518"},"observation_digest":"sha256:301ddbee061c41d9bdc02eb52fc34bfc46f2d25680c8ab56ee2846e4c08ad297","observation_id":"fe9b8ed9-e92e-44c5-8d57-8c22feb906e1","resolution":{"observed_at":"2026-08-06T23:34:35.739408Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T23:34:35.796368Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.17518","last_updated":"2025-06-20T23:47:04Z","snapshot_observed_at":"2026-08-10T10:35:48.301748Z","submitted_at":"2025-06-20T23:47:04Z","title":"A Survey of State Representation Learning for Deep Reinforcement Learning","version":1},"reference_index":49,"source":"arxiv_source","source_observed_at":"2026-08-06T23:34:35.796368Z"},"links":{"citing_paper":"/paper/2506.17518"},"observation_digest":"sha256:38d22dc73aa695d9146ebdd34bb3b570d3b80737c28e31ba859550334978be0a","observation_id":"df0d1b2d-0bce-4672-9c03-a6f1cb2fa667","resolution":{"observed_at":"2026-08-06T23:34:35.796368Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T23:34:35.916056Z","title":"Visualizing and understanding atari agents","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2506.17518","last_updated":"2025-06-20T23:47:04Z","snapshot_observed_at":"2026-08-10T10:35:48.301748Z","submitted_at":"2025-06-20T23:47:04Z","title":"A Survey of State Representation Learning for Deep Reinforcement Learning","version":1},"reference_index":50,"source":"arxiv_source","source_observed_at":"2026-08-06T23:34:35.916056Z"},"links":{"citing_paper":"/paper/2506.17518"},"observation_digest":"sha256:0429863f9f59fd69462e4ba3cf2a11395314ffa5e885822aea69afedfc63302c","observation_id":"ae35fd39-5e53-4b9e-b7ab-5588b39982c1","resolution":{"observed_at":"2026-08-06T23:34:35.916056Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T23:34:36.001995Z","title":"Bootstrap your own latent-a new approach to self-supervised learning","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2506.17518","last_updated":"2025-06-20T23:47:04Z","snapshot_observed_at":"2026-08-10T10:35:48.301748Z","submitted_at":"2025-06-20T23:47:04Z","title":"A Survey of State Representation Learning for Deep Reinforcement Learning","version":1},"reference_index":51,"source":"arxiv_source","source_observed_at":"2026-08-06T23:34:36.001995Z"},"links":{"citing_paper":"/paper/2506.17518"},"observation_digest":"sha256:e3fc1980cf91b49a4cc8c8ee68003abb59ff9af335cc7686ca3b378ca63ab4fa","observation_id":"eca950bb-7425-4834-9125-57c302468bf8","resolution":{"observed_at":"2026-08-06T23:34:36.001995Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2004.14646","last_updated":"2020-04-30T09:09:41Z","snapshot_observed_at":"2026-08-08T20:57:03.225414Z","submitted_at":"2020-04-30T09:09:41Z","title":"Bootstrap Latent-Predictive Representations for Multitask Reinforcement Learning","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2004.14646","snapshot_observed_at":"2026-08-06T23:34:36.114222Z","title":"Bootstrap latent-predictive representations for multitask reinforcement learning","venue":null,"work_id":null,"year":2004},"citing_paper":{"arxiv_id":"2506.17518","last_updated":"2025-06-20T23:47:04Z","snapshot_observed_at":"2026-08-10T10:35:48.301748Z","submitted_at":"2025-06-20T23:47:04Z","title":"A Survey of State Representation Learning for Deep Reinforcement Learning","version":1},"reference_index":52,"source":"arxiv_source","source_observed_at":"2026-08-06T23:34:36.114222Z"},"links":{"cited_paper":"/paper/2004.14646","citing_paper":"/paper/2506.17518"},"observation_digest":"sha256:1d9dade60885c2a33f75dd561179420693e6a22d05726b4537f102879101019d","observation_id":"fe79a99b-7be5-4b09-a73b-94efda088bd3","resolution":{"observed_at":"2026-08-06T23:34:36.114222Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T23:34:36.221641Z","title":"Stabilizing deep q-learning with convnets and vision transformers under data augmentation","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2506.17518","last_updated":"2025-06-20T23:47:04Z","snapshot_observed_at":"2026-08-10T10:35:48.301748Z","submitted_at":"2025-06-20T23:47:04Z","title":"A Survey of State Representation Learning for Deep Reinforcement Learning","version":1},"reference_index":53,"source":"arxiv_source","source_observed_at":"2026-08-06T23:34:36.221641Z"},"links":{"citing_paper":"/paper/2506.17518"},"observation_digest":"sha256:0a3e234c6d77b5c295ca80121b99d8ef56b7a5193e0469595c77d7f83db8d78c","observation_id":"1bba53d9-760b-481c-b512-251f2567ba96","resolution":{"observed_at":"2026-08-06T23:34:36.221641Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T23:34:36.304016Z","title":"Masked autoencoders are scalable vision learners","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2506.17518","last_updated":"2025-06-20T23:47:04Z","snapshot_observed_at":"2026-08-10T10:35:48.301748Z","submitted_at":"2025-06-20T23:47:04Z","title":"A Survey of State Representation Learning for Deep Reinforcement Learning","version":1},"reference_index":54,"source":"arxiv_source","source_observed_at":"2026-08-06T23:34:36.304016Z"},"links":{"citing_paper":"/paper/2506.17518"},"observation_digest":"sha256:529cc8ebfaa4904ef10019fbeace768aac164ba5d4962df457de68a372664a23","observation_id":"e4c8e298-9480-419b-8506-7eced093effa","resolution":{"observed_at":"2026-08-06T23:34:36.304016Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T23:34:36.386222Z","title":"Rainbow: Combining improvements in deep reinforcement learning","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2506.17518","last_updated":"2025-06-20T23:47:04Z","snapshot_observed_at":"2026-08-10T10:35:48.301748Z","submitted_at":"2025-06-20T23:47:04Z","title":"A Survey of State Representation Learning for Deep Reinforcement Learning","version":1},"reference_index":55,"source":"arxiv_source","source_observed_at":"2026-08-06T23:34:36.386222Z"},"links":{"citing_paper":"/paper/2506.17518"},"observation_digest":"sha256:0f0dd1396cf236087fbc5f1964600b7417b443c77614c8675e0117504fb5306a","observation_id":"3319eecb-fbf2-4385-a9d8-20ad59358d79","resolution":{"observed_at":"2026-08-06T23:34:36.386222Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T23:34:36.466449Z","title":"Multi-task deep reinforcement learning with popart","venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2506.17518","last_updated":"2025-06-20T23:47:04Z","snapshot_observed_at":"2026-08-10T10:35:48.301748Z","submitted_at":"2025-06-20T23:47:04Z","title":"A Survey of State Representation Learning for Deep Reinforcement Learning","version":1},"reference_index":56,"source":"arxiv_source","source_observed_at":"2026-08-06T23:34:36.466449Z"},"links":{"citing_paper":"/paper/2506.17518"},"observation_digest":"sha256:cf02d27c0082e5b8cc7ee1858630221a64f1af9b5ed24c1ae16743f7344885f6","observation_id":"e42fb4a2-6188-4938-8fb3-35b3692031e4","resolution":{"observed_at":"2026-08-06T23:34:36.466449Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T23:34:36.568115Z","title":"Burgess, Xavier Glorot, Matthew M","venue":null,"work_id":null,"year":2016},"citing_paper":{"arxiv_id":"2506.17518","last_updated":"2025-06-20T23:47:04Z","snapshot_observed_at":"2026-08-10T10:35:48.301748Z","submitted_at":"2025-06-20T23:47:04Z","title":"A Survey of State Representation Learning for Deep Reinforcement Learning","version":1},"reference_index":57,"source":"arxiv_source","source_observed_at":"2026-08-06T23:34:36.568115Z"},"links":{"citing_paper":"/paper/2506.17518"},"observation_digest":"sha256:a10f0e38c08bf7ff426e9ae9ef466a90a9a633c53b0e5cf1b944c8d9ab514def","observation_id":"d658735c-0c9c-4693-9503-2df3f5d78b0f","resolution":{"observed_at":"2026-08-06T23:34:36.568115Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T23:34:36.642169Z","title":"Darla: Improving zero-shot transfer in reinforcement learning","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2506.17518","last_updated":"2025-06-20T23:47:04Z","snapshot_observed_at":"2026-08-10T10:35:48.301748Z","submitted_at":"2025-06-20T23:47:04Z","title":"A Survey of State Representation Learning for Deep Reinforcement Learning","version":1},"reference_index":58,"source":"arxiv_source","source_observed_at":"2026-08-06T23:34:36.642169Z"},"links":{"citing_paper":"/paper/2506.17518"},"observation_digest":"sha256:9ed1223b264d836919b772d31db332bd5afa48192cb2d1f3cee04c69faf12ba1","observation_id":"20063910-070a-40ae-8551-acb7357e343d","resolution":{"observed_at":"2026-08-06T23:34:36.642169Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1808.06670","last_updated":"2019-02-22T18:38:15Z","snapshot_observed_at":"2026-08-14T18:39:08.324821Z","submitted_at":"2018-08-20T19:52:51Z","title":"Learning deep representations by mutual information estimation and maximization","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1808.06670","snapshot_observed_at":"2026-08-06T23:34:36.711613Z","title":"Learning deep representations by mutual information estimation and maximization","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2506.17518","last_updated":"2025-06-20T23:47:04Z","snapshot_observed_at":"2026-08-10T10:35:48.301748Z","submitted_at":"2025-06-20T23:47:04Z","title":"A Survey of State Representation Learning for Deep Reinforcement Learning","version":1},"reference_index":59,"source":"arxiv_source","source_observed_at":"2026-08-06T23:34:36.711613Z"},"links":{"cited_paper":"/paper/1808.06670","citing_paper":"/paper/2506.17518"},"observation_digest":"sha256:fa391aec36c71b24dd45fd7d2ea0a3d30d3ff478e94c94ba4ad15e37d322f242","observation_id":"e0e82cff-cc47-44db-942c-9e862567aa81","resolution":{"observed_at":"2026-08-06T23:34:36.711613Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T23:34:36.855098Z","title":"Revisiting data augmentation in deep reinforcement learning, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.17518","last_updated":"2025-06-20T23:47:04Z","snapshot_observed_at":"2026-08-10T10:35:48.301748Z","submitted_at":"2025-06-20T23:47:04Z","title":"A Survey of State Representation Learning for Deep Reinforcement Learning","version":1},"reference_index":60,"source":"arxiv_source","source_observed_at":"2026-08-06T23:34:36.855098Z"},"links":{"citing_paper":"/paper/2506.17518"},"observation_digest":"sha256:a941777396a56784c82025cae17172eb289965986c880d060e23ff61d3e2e904","observation_id":"8bec8ca3-b945-41f2-90d3-e3da9bf3c7ce","resolution":{"observed_at":"2026-08-06T23:34:36.855098Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T23:34:37.022592Z","title":"Spectrum random masking for generalization in image-based reinforcement learning","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2506.17518","last_updated":"2025-06-20T23:47:04Z","snapshot_observed_at":"2026-08-10T10:35:48.301748Z","submitted_at":"2025-06-20T23:47:04Z","title":"A Survey of State Representation Learning for Deep Reinforcement Learning","version":1},"reference_index":61,"source":"arxiv_source","source_observed_at":"2026-08-06T23:34:37.022592Z"},"links":{"citing_paper":"/paper/2506.17518"},"observation_digest":"sha256:8fa04b1cbc56d73c87539daa48ee01335ab47837a908bef82ec5a34852ef3d17","observation_id":"1eda50b0-e177-42c7-a462-77a8cbae59a0","resolution":{"observed_at":"2026-08-06T23:34:37.022592Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T23:34:37.261134Z","title":"Generalization in reinforcement learning with selective noise injection and information bottleneck","venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2506.17518","last_updated":"2025-06-20T23:47:04Z","snapshot_observed_at":"2026-08-10T10:35:48.301748Z","submitted_at":"2025-06-20T23:47:04Z","title":"A Survey of State Representation Learning for Deep Reinforcement Learning","version":1},"reference_index":62,"source":"arxiv_source","source_observed_at":"2026-08-06T23:34:37.261134Z"},"links":{"citing_paper":"/paper/2506.17518"},"observation_digest":"sha256:d41853224a81eea06e0535b97a98f6ab75ad7fb488f5fc8e73b77ffbb2a6fb54","observation_id":"c01cccb3-b34b-4609-8163-e87fd82749fd","resolution":{"observed_at":"2026-08-06T23:34:37.261134Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T23:34:37.449983Z","title":"Zero-shot reinforcement learning via function encoders","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.17518","last_updated":"2025-06-20T23:47:04Z","snapshot_observed_at":"2026-08-10T10:35:48.301748Z","submitted_at":"2025-06-20T23:47:04Z","title":"A Survey of State Representation Learning for Deep Reinforcement Learning","version":1},"reference_index":63,"source":"arxiv_source","source_observed_at":"2026-08-06T23:34:37.449983Z"},"links":{"citing_paper":"/paper/2506.17518"},"observation_digest":"sha256:742e549dc604aa3f80334c762098a7e2ce5705915c58d4ba0907dc01e6e56582","observation_id":"0433bb9d-31b3-4215-9bcc-8f11a457e792","resolution":{"observed_at":"2026-08-06T23:34:37.449983Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T23:34:37.588177Z","title":"Offline multitask representation learning for reinforcement learning","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.17518","last_updated":"2025-06-20T23:47:04Z","snapshot_observed_at":"2026-08-10T10:35:48.301748Z","submitted_at":"2025-06-20T23:47:04Z","title":"A Survey of State Representation Learning for Deep Reinforcement Learning","version":1},"reference_index":64,"source":"arxiv_source","source_observed_at":"2026-08-06T23:34:37.588177Z"},"links":{"citing_paper":"/paper/2506.17518"},"observation_digest":"sha256:6c2e35f0e117ca78312ca40d0a94e5ab2e2ff0e9b835f75db6a4d8b25cb7a042","observation_id":"0d12324e-724e-4463-a270-a5083354bba0","resolution":{"observed_at":"2026-08-06T23:34:37.588177Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T23:34:37.663016Z","title":"Principled offline rl in the presence of rich exogenous information","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.17518","last_updated":"2025-06-20T23:47:04Z","snapshot_observed_at":"2026-08-10T10:35:48.301748Z","submitted_at":"2025-06-20T23:47:04Z","title":"A Survey of State Representation Learning for Deep Reinforcement Learning","version":1},"reference_index":65,"source":"arxiv_source","source_observed_at":"2026-08-06T23:34:37.663016Z"},"links":{"citing_paper":"/paper/2506.17518"},"observation_digest":"sha256:f2c42fdf2867e150cc0632051812cd81a3390ea549154ec19102563a0813e492","observation_id":"7be4c4ed-aeee-4cbe-8eda-9393ce835ad4","resolution":{"observed_at":"2026-08-06T23:34:37.663016Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T23:34:37.743091Z","title":"Representation learning in deep rl via discrete information bottleneck","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.17518","last_updated":"2025-06-20T23:47:04Z","snapshot_observed_at":"2026-08-10T10:35:48.301748Z","submitted_at":"2025-06-20T23:47:04Z","title":"A Survey of State Representation Learning for Deep Reinforcement Learning","version":1},"reference_index":66,"source":"arxiv_source","source_observed_at":"2026-08-06T23:34:37.743091Z"},"links":{"citing_paper":"/paper/2506.17518"},"observation_digest":"sha256:a215039120985317638d67478777196daebc83b1bf61d875ae8ef97dd2885a9b","observation_id":"65ac7c63-354d-422b-a49e-774ee331824f","resolution":{"observed_at":"2026-08-06T23:34:37.743091Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T23:34:37.839439Z","title":"Zero-shot reinforcement learning from low quality data","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.17518","last_updated":"2025-06-20T23:47:04Z","snapshot_observed_at":"2026-08-10T10:35:48.301748Z","submitted_at":"2025-06-20T23:47:04Z","title":"A Survey of State Representation Learning for Deep Reinforcement Learning","version":1},"reference_index":67,"source":"arxiv_source","source_observed_at":"2026-08-06T23:34:37.839439Z"},"links":{"citing_paper":"/paper/2506.17518"},"observation_digest":"sha256:08c01c9fb4affff7126cfa2705b936fc7b93546aec711fe27eeb6e0b66fe195c","observation_id":"9c91ce1a-d6fc-4b13-a839-2584aca7db98","resolution":{"observed_at":"2026-08-06T23:34:37.839439Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T23:34:37.956454Z","title":"Contextual decision processes with low bellman rank are pac-learnable","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2506.17518","last_updated":"2025-06-20T23:47:04Z","snapshot_observed_at":"2026-08-10T10:35:48.301748Z","submitted_at":"2025-06-20T23:47:04Z","title":"A Survey of State Representation Learning for Deep Reinforcement Learning","version":1},"reference_index":68,"source":"arxiv_source","source_observed_at":"2026-08-06T23:34:37.956454Z"},"links":{"citing_paper":"/paper/2506.17518"},"observation_digest":"sha256:6198ce42e7fff7a61a22d36e2175f3775b6956059b4f33a67b5824760732c428","observation_id":"b709a84a-fdaf-452f-a4d8-14eb2231df6f","resolution":{"observed_at":"2026-08-06T23:34:37.956454Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2109.14188","last_updated":"2021-09-29T04:22:49Z","snapshot_observed_at":"2026-08-13T18:03:09.255028Z","submitted_at":"2021-09-29T04:22:49Z","title":"Information-Bottleneck-Based Behavior Representation Learning for Multi-agent Reinforcement learning","version":1},"cited_work":{"arxiv_id":"2109.14188","doi":null,"metadata_source":"pith","pith_arxiv_id":"2109.14188","snapshot_observed_at":"2026-08-06T23:34:50.161514Z","title":"Information-Bottleneck-Based Behavior Representation Learning for Multi-agent Reinforcement learning","venue":"cs.LG","work_id":"a0c9b59f-85f0-4005-ad10-33d61fc88c1b","year":2021},"citing_paper":{"arxiv_id":"2506.17518","last_updated":"2025-06-20T23:47:04Z","snapshot_observed_at":"2026-08-10T10:35:48.301748Z","submitted_at":"2025-06-20T23:47:04Z","title":"A Survey of State Representation Learning for Deep Reinforcement Learning","version":1},"reference_index":69,"source":"arxiv_source","source_observed_at":"2026-08-06T23:34:38.133164Z"},"links":{"cited_paper":"/paper/2109.14188","citing_paper":"/paper/2506.17518"},"observation_digest":"sha256:2dcf9cd6fa98739b2eab313be7422ccf5e68411ef1624840df2eb39f41778b47","observation_id":"7d7f1d07-9b23-4454-b864-4851c395dc9d","resolution":{"observed_at":"2026-08-06T23:34:50.236797Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1705.09805","last_updated":"2017-07-24T12:15:40Z","snapshot_observed_at":"2026-08-14T20:57:50.352102Z","submitted_at":"2017-05-27T11:17:49Z","title":"PVEs: Position-Velocity Encoders for Unsupervised Learning of Structured State Representations","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1705.09805","snapshot_observed_at":"2026-08-06T23:34:38.254561Z","title":"Riedmiller","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2506.17518","last_updated":"2025-06-20T23:47:04Z","snapshot_observed_at":"2026-08-10T10:35:48.301748Z","submitted_at":"2025-06-20T23:47:04Z","title":"A Survey of State Representation Learning for Deep Reinforcement Learning","version":1},"reference_index":70,"source":"arxiv_source","source_observed_at":"2026-08-06T23:34:38.254561Z"},"links":{"cited_paper":"/paper/1705.09805","citing_paper":"/paper/2506.17518"},"observation_digest":"sha256:70721b58affaa3558fa015ab22b4d32c262e8e79e368ade6b1e0ec6e0e9c6212","observation_id":"e1d3cdb0-89c9-420a-b031-d3b7b0f09b42","resolution":{"observed_at":"2026-08-06T23:34:38.254561Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T23:34:38.443902Z","title":null,"venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2506.17518","last_updated":"2025-06-20T23:47:04Z","snapshot_observed_at":"2026-08-10T10:35:48.301748Z","submitted_at":"2025-06-20T23:47:04Z","title":"A Survey of State Representation Learning for Deep Reinforcement Learning","version":1},"reference_index":71,"source":"arxiv_source","source_observed_at":"2026-08-06T23:34:38.443902Z"},"links":{"citing_paper":"/paper/2506.17518"},"observation_digest":"sha256:dfad7fa10ebe5e5867e93b902a81d9169fe0262efef88702bdf901e0611ba789","observation_id":"31800c70-4ce7-4a0a-9ece-0ff30c243311","resolution":{"observed_at":"2026-08-06T23:34:38.443902Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T23:34:38.671178Z","title":"Scaling up multi-task robotic reinforcement learning","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2506.17518","last_updated":"2025-06-20T23:47:04Z","snapshot_observed_at":"2026-08-10T10:35:48.301748Z","submitted_at":"2025-06-20T23:47:04Z","title":"A Survey of State Representation Learning for Deep Reinforcement Learning","version":1},"reference_index":72,"source":"arxiv_source","source_observed_at":"2026-08-06T23:34:38.671178Z"},"links":{"citing_paper":"/paper/2506.17518"},"observation_digest":"sha256:d4be57010f9d55113a65e1c45525be1f01d1ceef6a3e4789dcfb1ab800fb679f","observation_id":"c85309c9-25de-4d18-b020-ccf4c33d33cc","resolution":{"observed_at":"2026-08-06T23:34:38.671178Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T23:34:38.806508Z","title":"Terminal prediction as an auxiliary task for deep reinforcement learning","venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2506.17518","last_updated":"2025-06-20T23:47:04Z","snapshot_observed_at":"2026-08-10T10:35:48.301748Z","submitted_at":"2025-06-20T23:47:04Z","title":"A Survey of State Representation Learning for Deep Reinforcement Learning","version":1},"reference_index":73,"source":"arxiv_source","source_observed_at":"2026-08-06T23:34:38.806508Z"},"links":{"citing_paper":"/paper/2506.17518"},"observation_digest":"sha256:e29488f2972ac14b5dc8293014e0f1ea2b626399ae88a54d83c16b608eb64bcf","observation_id":"a710befc-6a13-4041-b862-654ee240e9bd","resolution":{"observed_at":"2026-08-06T23:34:38.806508Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2110.14096","last_updated":"2021-10-27T00:32:07Z","snapshot_observed_at":"2026-08-06T08:41:55.367764Z","submitted_at":"2021-10-27T00:32:07Z","title":"Towards Robust Bisimulation Metric Learning","version":1},"cited_work":{"arxiv_id":"2110.14096","doi":null,"metadata_source":"pith","pith_arxiv_id":"2110.14096","snapshot_observed_at":"2026-08-06T23:34:49.829499Z","title":"Towards Robust Bisimulation Metric Learning","venue":"cs.LG","work_id":"6c4cce6a-ead1-49ea-b540-d95e5005d261","year":2021},"citing_paper":{"arxiv_id":"2506.17518","last_updated":"2025-06-20T23:47:04Z","snapshot_observed_at":"2026-08-10T10:35:48.301748Z","submitted_at":"2025-06-20T23:47:04Z","title":"A Survey of State Representation Learning for Deep Reinforcement Learning","version":1},"reference_index":74,"source":"arxiv_source","source_observed_at":"2026-08-06T23:34:38.893179Z"},"links":{"cited_paper":"/paper/2110.14096","citing_paper":"/paper/2506.17518"},"observation_digest":"sha256:41c5b7b49982129b04320aac4ea4fc2e77a5315150e0fcbb500fe887777a0ec6","observation_id":"5f860681-6a52-44bd-8162-3a08283fc4dc","resolution":{"observed_at":"2026-08-06T23:34:49.900073Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2406.02035","last_updated":"2024-06-04T07:22:12Z","snapshot_observed_at":"2026-08-12T23:50:49.831930Z","submitted_at":"2024-06-04T07:22:12Z","title":"A Unifying Framework for Action-Conditional Self-Predictive Reinforcement Learning","version":1},"cited_work":{"arxiv_id":"2406.02035","doi":null,"metadata_source":"pith","pith_arxiv_id":"2406.02035","snapshot_observed_at":"2026-08-06T23:34:49.588127Z","title":"A Unifying Framework for Action-Conditional Self-Predictive Reinforcement Learning","venue":"cs.LG","work_id":"8c8dae54-9c1c-4778-9b34-8a3973556098","year":2024},"citing_paper":{"arxiv_id":"2506.17518","last_updated":"2025-06-20T23:47:04Z","snapshot_observed_at":"2026-08-10T10:35:48.301748Z","submitted_at":"2025-06-20T23:47:04Z","title":"A Survey of State Representation Learning for Deep Reinforcement Learning","version":1},"reference_index":75,"source":"arxiv_source","source_observed_at":"2026-08-06T23:34:39.068965Z"},"links":{"cited_paper":"/paper/2406.02035","citing_paper":"/paper/2506.17518"},"observation_digest":"sha256:a85859c7f150637e4e8934cb45c5a2aa6e6ccb01f1d7ec37da116ad7a9d258c1","observation_id":"f0c82f2f-9e5e-49b2-833d-cb51c9ae672b","resolution":{"observed_at":"2026-08-06T23:34:49.702870Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2406.06037","last_updated":"2024-06-10T06:06:38Z","snapshot_observed_at":"2026-08-12T23:46:43.844520Z","submitted_at":"2024-06-10T06:06:38Z","title":"Investigating Pre-Training Objectives for Generalization in Vision-Based Reinforcement Learning","version":1},"cited_work":{"arxiv_id":"2406.06037","doi":null,"metadata_source":"pith","pith_arxiv_id":"2406.06037","snapshot_observed_at":"2026-08-06T23:34:49.333636Z","title":"Investigating Pre-Training Objectives for Generalization in Vision-Based Reinforcement Learning","venue":"cs.LG","work_id":"2d6e3272-59c0-4c8c-af26-13b5baf0ca23","year":2024},"citing_paper":{"arxiv_id":"2506.17518","last_updated":"2025-06-20T23:47:04Z","snapshot_observed_at":"2026-08-10T10:35:48.301748Z","submitted_at":"2025-06-20T23:47:04Z","title":"A Survey of State Representation Learning for Deep Reinforcement Learning","version":1},"reference_index":76,"source":"arxiv_source","source_observed_at":"2026-08-06T23:34:39.159134Z"},"links":{"cited_paper":"/paper/2406.06037","citing_paper":"/paper/2506.17518"},"observation_digest":"sha256:61d989d6b91c97089b295408240f11272aa2c2c7653b0c918092398fca9fbb0b","observation_id":"744b1512-e3c0-45ec-9d1e-50d5ebdc8aab","resolution":{"observed_at":"2026-08-06T23:34:49.424737Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1312.6114","last_updated":"2022-12-10T21:04:00Z","snapshot_observed_at":"2026-08-14T23:50:45.029465Z","submitted_at":"2013-12-20T20:58:10Z","title":"Auto-Encoding Variational Bayes","version":11},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1312.6114","snapshot_observed_at":"2026-08-06T23:34:39.165844Z","title":"Auto-encoding variational bayes","venue":null,"work_id":null,"year":2014},"citing_paper":{"arxiv_id":"2506.17518","last_updated":"2025-06-20T23:47:04Z","snapshot_observed_at":"2026-08-10T10:35:48.301748Z","submitted_at":"2025-06-20T23:47:04Z","title":"A Survey of State Representation Learning for Deep Reinforcement Learning","version":1},"reference_index":77,"source":"arxiv_source","source_observed_at":"2026-08-06T23:34:39.165844Z"},"links":{"cited_paper":"/paper/1312.6114","citing_paper":"/paper/2506.17518"},"observation_digest":"sha256:164ab06752b4fe8dc41f13ef26782644c9e06bb49493fc3e0d712eba1c74489e","observation_id":"0dbccc72-5fb9-4044-918e-4a195eee8286","resolution":{"observed_at":"2026-08-06T23:34:39.165844Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2004.13649","last_updated":"2021-03-07T16:37:37Z","snapshot_observed_at":"2026-08-09T00:13:45.533552Z","submitted_at":"2020-04-28T16:48:16Z","title":"Image Augmentation Is All You Need: Regularizing Deep Reinforcement Learning from Pixels","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2004.13649","snapshot_observed_at":"2026-08-06T23:34:39.216865Z","title":"Image augmentation is all you need: Regularizing deep reinforcement learning from pixels","venue":null,"work_id":null,"year":2004},"citing_paper":{"arxiv_id":"2506.17518","last_updated":"2025-06-20T23:47:04Z","snapshot_observed_at":"2026-08-10T10:35:48.301748Z","submitted_at":"2025-06-20T23:47:04Z","title":"A Survey of State Representation Learning for Deep Reinforcement Learning","version":1},"reference_index":78,"source":"arxiv_source","source_observed_at":"2026-08-06T23:34:39.216865Z"},"links":{"cited_paper":"/paper/2004.13649","citing_paper":"/paper/2506.17518"},"observation_digest":"sha256:b2e69d1141b97cf954f335638697fba3072619a714b67aeb558abe35ab2198d2","observation_id":"8fe5094d-cd03-427a-a807-38d940521959","resolution":{"observed_at":"2026-08-06T23:34:39.216865Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T23:34:39.274360Z","title":"Pac reinforcement learning with rich observations","venue":null,"work_id":null,"year":2016},"citing_paper":{"arxiv_id":"2506.17518","last_updated":"2025-06-20T23:47:04Z","snapshot_observed_at":"2026-08-10T10:35:48.301748Z","submitted_at":"2025-06-20T23:47:04Z","title":"A Survey of State Representation Learning for Deep Reinforcement Learning","version":1},"reference_index":79,"source":"arxiv_source","source_observed_at":"2026-08-06T23:34:39.274360Z"},"links":{"citing_paper":"/paper/2506.17518"},"observation_digest":"sha256:a01af9a35b8681613300499de6c2784e460d3389eb9b93676c7c6c96881dfce3","observation_id":"89f31156-3149-4ae3-baab-e01d2f9308ec","resolution":{"observed_at":"2026-08-06T23:34:39.274360Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T23:34:39.320161Z","title":"Guaranteed discovery of control-endogenous latent states with multi-step inverse models","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.17518","last_updated":"2025-06-20T23:47:04Z","snapshot_observed_at":"2026-08-10T10:35:48.301748Z","submitted_at":"2025-06-20T23:47:04Z","title":"A Survey of State Representation Learning for Deep Reinforcement Learning","version":1},"reference_index":80,"source":"arxiv_source","source_observed_at":"2026-08-06T23:34:39.320161Z"},"links":{"citing_paper":"/paper/2506.17518"},"observation_digest":"sha256:d8463aa9212d68b8968e0074f1edc796ea90a51d9c02b78d8e8dbee5c0924000","observation_id":"6bf1343d-dd05-4ffd-85eb-2a06c9066dc6","resolution":{"observed_at":"2026-08-06T23:34:39.320161Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2004.14990","last_updated":"2020-11-05T06:04:50Z","snapshot_observed_at":"2026-08-13T23:41:36.426730Z","submitted_at":"2020-04-30T17:35:32Z","title":"Reinforcement Learning with Augmented Data","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2004.14990","snapshot_observed_at":"2026-08-06T23:34:39.383806Z","title":"Reinforcement learning with augmented data","venue":null,"work_id":null,"year":2004},"citing_paper":{"arxiv_id":"2506.17518","last_updated":"2025-06-20T23:47:04Z","snapshot_observed_at":"2026-08-10T10:35:48.301748Z","submitted_at":"2025-06-20T23:47:04Z","title":"A Survey of State Representation Learning for Deep Reinforcement Learning","version":1},"reference_index":81,"source":"arxiv_source","source_observed_at":"2026-08-06T23:34:39.383806Z"},"links":{"cited_paper":"/paper/2004.14990","citing_paper":"/paper/2506.17518"},"observation_digest":"sha256:715735d38a3bc639617a8b0cc57b629e72d09863faaebf2d5ba594202e4c4e27","observation_id":"4f218946-ab8e-4744-b4c3-a7b34b8e74de","resolution":{"observed_at":"2026-08-06T23:34:39.383806Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T23:34:39.433199Z","title":"Metrics and continuity in reinforcement learning","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2506.17518","last_updated":"2025-06-20T23:47:04Z","snapshot_observed_at":"2026-08-10T10:35:48.301748Z","submitted_at":"2025-06-20T23:47:04Z","title":"A Survey of State Representation Learning for Deep Reinforcement Learning","version":1},"reference_index":82,"source":"arxiv_source","source_observed_at":"2026-08-06T23:34:39.433199Z"},"links":{"citing_paper":"/paper/2506.17518"},"observation_digest":"sha256:6246a44b388d4853eada0886b0f190832b878c1179d512eac796f48776281280","observation_id":"a2fa7013-cd29-4408-868a-d9aa59bf8b5d","resolution":{"observed_at":"2026-08-06T23:34:39.433199Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T23:34:39.490486Z","title":"A path towards autonomous machine intelligence version 0.9","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2506.17518","last_updated":"2025-06-20T23:47:04Z","snapshot_observed_at":"2026-08-10T10:35:48.301748Z","submitted_at":"2025-06-20T23:47:04Z","title":"A Survey of State Representation Learning for Deep Reinforcement Learning","version":1},"reference_index":83,"source":"arxiv_source","source_observed_at":"2026-08-06T23:34:39.490486Z"},"links":{"citing_paper":"/paper/2506.17518"},"observation_digest":"sha256:add06f6a133dc1cbcbdaf21b440f224d304a9f841acca611ec25d0277b657ff7","observation_id":"90edb0d9-672e-4a28-8ef6-c372ec1c25e6","resolution":{"observed_at":"2026-08-06T23:34:39.490486Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1709.05185","last_updated":"2017-09-15T13:15:58Z","snapshot_observed_at":"2026-08-14T20:32:50.251008Z","submitted_at":"2017-09-15T13:15:58Z","title":"Unsupervised state representation learning with robotic priors: a robustness benchmark","version":1},"cited_work":{"arxiv_id":"1709.05185","doi":null,"metadata_source":"pith","pith_arxiv_id":"1709.05185","snapshot_observed_at":"2026-08-06T23:34:49.111460Z","title":"Unsupervised state representation learning with robotic priors: a robustness benchmark","venue":"cs.AI","work_id":"478335c6-f17d-4a73-b658-05b76ff3ff80","year":2017},"citing_paper":{"arxiv_id":"2506.17518","last_updated":"2025-06-20T23:47:04Z","snapshot_observed_at":"2026-08-10T10:35:48.301748Z","submitted_at":"2025-06-20T23:47:04Z","title":"A Survey of State Representation Learning for Deep Reinforcement Learning","version":1},"reference_index":85,"source":"arxiv_source","source_observed_at":"2026-08-06T23:34:39.629835Z"},"links":{"cited_paper":"/paper/1709.05185","citing_paper":"/paper/2506.17518"},"observation_digest":"sha256:99076f4cc4fee11cbc7124cbb536dd85585815888b45ac26ef8e336451baea92","observation_id":"fb10e4d9-1a12-48df-8e88-fa51638cb088","resolution":{"observed_at":"2026-08-06T23:34:49.177840Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1802.04181","last_updated":"2018-06-05T13:52:23Z","snapshot_observed_at":"2026-08-14T19:46:46.472398Z","submitted_at":"2018-02-12T16:53:48Z","title":"State Representation Learning for Control: An Overview","version":2},"cited_work":{"arxiv_id":"1802.04181","doi":null,"metadata_source":"pith","pith_arxiv_id":"1802.04181","snapshot_observed_at":"2026-08-06T23:34:48.904734Z","title":"State Representation Learning for Control: An Overview","venue":"cs.AI","work_id":"de8c303f-128c-4b63-b572-84fef00760b4","year":2018},"citing_paper":{"arxiv_id":"2506.17518","last_updated":"2025-06-20T23:47:04Z","snapshot_observed_at":"2026-08-10T10:35:48.301748Z","submitted_at":"2025-06-20T23:47:04Z","title":"A Survey of State Representation Learning for Deep Reinforcement Learning","version":1},"reference_index":86,"source":"arxiv_source","source_observed_at":"2026-08-06T23:34:39.756981Z"},"links":{"cited_paper":"/paper/1802.04181","citing_paper":"/paper/2506.17518"},"observation_digest":"sha256:b2f24ab06d4f5a1f38508b74f172218f6e1536faccacb451a7fa139a9b2fabd5","observation_id":"453d13b6-58a2-45eb-89f8-95f7d3a24ff5","resolution":{"observed_at":"2026-08-06T23:34:48.979376Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T23:34:39.836538Z","title":"Normalization enhances generalization in visual reinforcement learning","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.17518","last_updated":"2025-06-20T23:47:04Z","snapshot_observed_at":"2026-08-10T10:35:48.301748Z","submitted_at":"2025-06-20T23:47:04Z","title":"A Survey of State Representation Learning for Deep Reinforcement Learning","version":1},"reference_index":87,"source":"arxiv_source","source_observed_at":"2026-08-06T23:34:39.836538Z"},"links":{"citing_paper":"/paper/2506.17518"},"observation_digest":"sha256:83d2f69d034ed6d9ad27bd357f5c4b6e11a935e3374792f439c95b2e75dda707","observation_id":"e7d23b61-9307-4e5b-be45-8bcdc6ae0445","resolution":{"observed_at":"2026-08-06T23:34:39.836538Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T23:34:39.891192Z","title":"Provable general function class representation learning in multitask bandits and mdp","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2506.17518","last_updated":"2025-06-20T23:47:04Z","snapshot_observed_at":"2026-08-10T10:35:48.301748Z","submitted_at":"2025-06-20T23:47:04Z","title":"A Survey of State Representation Learning for Deep Reinforcement Learning","version":1},"reference_index":88,"source":"arxiv_source","source_observed_at":"2026-08-06T23:34:39.891192Z"},"links":{"citing_paper":"/paper/2506.17518"},"observation_digest":"sha256:f1570adf440620c94ea07502a23af746fa9c88430a716562761f603b98253dab","observation_id":"c02c11b6-0b44-485c-ad2f-cbf3405d2689","resolution":{"observed_at":"2026-08-06T23:34:39.891192Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2102.13089","last_updated":"2021-02-25T18:56:11Z","snapshot_observed_at":"2026-08-09T04:57:14.490650Z","submitted_at":"2021-02-25T18:56:11Z","title":"On The Effect of Auxiliary Tasks on Representation Dynamics","version":1},"cited_work":{"arxiv_id":"2102.13089","doi":null,"metadata_source":"pith","pith_arxiv_id":"2102.13089","snapshot_observed_at":"2026-08-06T23:34:48.629536Z","title":"On The Effect of Auxiliary Tasks on Representation Dynamics","venue":"cs.LG","work_id":"f91f7830-0d30-4197-88ce-f196b0a24710","year":2021},"citing_paper":{"arxiv_id":"2506.17518","last_updated":"2025-06-20T23:47:04Z","snapshot_observed_at":"2026-08-10T10:35:48.301748Z","submitted_at":"2025-06-20T23:47:04Z","title":"A Survey of State Representation Learning for Deep Reinforcement Learning","version":1},"reference_index":89,"source":"arxiv_source","source_observed_at":"2026-08-06T23:34:39.980915Z"},"links":{"cited_paper":"/paper/2102.13089","citing_paper":"/paper/2506.17518"},"observation_digest":"sha256:ae5895dae32d4719867a6e60ecbf03da52d0ee23a2aabce77c9ce80d9acfc66c","observation_id":"e7eb5e7d-1038-4773-8ba9-97e034c0e064","resolution":{"observed_at":"2026-08-06T23:34:48.676098Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2210.04561","last_updated":"2024-10-21T14:11:42Z","snapshot_observed_at":"2026-08-13T14:09:22.220522Z","submitted_at":"2022-10-10T11:01:57Z","title":"A Comprehensive Survey of Data Augmentation in Visual Reinforcement Learning","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2210.04561","snapshot_observed_at":"2026-08-06T23:34:40.091630Z","title":"A comprehensive survey of data augmentation in visual reinforcement learning, 2022","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2506.17518","last_updated":"2025-06-20T23:47:04Z","snapshot_observed_at":"2026-08-10T10:35:48.301748Z","submitted_at":"2025-06-20T23:47:04Z","title":"A Survey of State Representation Learning for Deep Reinforcement Learning","version":1},"reference_index":90,"source":"arxiv_source","source_observed_at":"2026-08-06T23:34:40.091630Z"},"links":{"cited_paper":"/paper/2210.04561","citing_paper":"/paper/2506.17518"},"observation_digest":"sha256:7c2d09f92ad3a8378a66396f9e8b2f70cea519c2df4ed8e5de9e251471543899","observation_id":"51bcdc9a-5394-4412-932f-b6e6ec3ea9ff","resolution":{"observed_at":"2026-08-06T23:34:40.091630Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T23:34:40.183919Z","title":"Revisiting plasticity in visual reinforcement learning: Data, modules and training stages","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.17518","last_updated":"2025-06-20T23:47:04Z","snapshot_observed_at":"2026-08-10T10:35:48.301748Z","submitted_at":"2025-06-20T23:47:04Z","title":"A Survey of State Representation Learning for Deep Reinforcement Learning","version":1},"reference_index":91,"source":"arxiv_source","source_observed_at":"2026-08-06T23:34:40.183919Z"},"links":{"citing_paper":"/paper/2506.17518"},"observation_digest":"sha256:475945901d2728e603b59d87d64916a53c459ff98c1e99ec2f08f5d20819335e","observation_id":"a91ebd6d-25b4-4462-894d-84d4a62889e3","resolution":{"observed_at":"2026-08-06T23:34:40.183919Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2210.00030","last_updated":"2023-03-07T02:29:59Z","snapshot_observed_at":"2026-08-11T15:42:16.204049Z","submitted_at":"2022-09-30T18:14:07Z","title":"VIP: Towards Universal Visual Reward and Representation via Value-Implicit Pre-Training","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2210.00030","snapshot_observed_at":"2026-08-06T23:34:40.275191Z","title":"Vip: Towards universal visual reward and representation via value-implicit pre-training, 2023","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.17518","last_updated":"2025-06-20T23:47:04Z","snapshot_observed_at":"2026-08-10T10:35:48.301748Z","submitted_at":"2025-06-20T23:47:04Z","title":"A Survey of State Representation Learning for Deep Reinforcement Learning","version":1},"reference_index":92,"source":"arxiv_source","source_observed_at":"2026-08-06T23:34:40.275191Z"},"links":{"cited_paper":"/paper/2210.00030","citing_paper":"/paper/2506.17518"},"observation_digest":"sha256:c6b7d6f18056c3c51e590cdc89c4b6860ad78b7e13775950e620074728367e8d","observation_id":"567422ef-5732-429e-abac-83880cf997ca","resolution":{"observed_at":"2026-08-06T23:34:40.275191Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T23:34:40.386436Z","title":"Where are we in the search for an artificial visual cortex for embodied intelligence? Advances in Neural Information Processing Systems, 36: 0 655--677, 2023","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.17518","last_updated":"2025-06-20T23:47:04Z","snapshot_observed_at":"2026-08-10T10:35:48.301748Z","submitted_at":"2025-06-20T23:47:04Z","title":"A Survey of State Representation Learning for Deep Reinforcement Learning","version":1},"reference_index":93,"source":"arxiv_source","source_observed_at":"2026-08-06T23:34:40.386436Z"},"links":{"citing_paper":"/paper/2506.17518"},"observation_digest":"sha256:00a6c1264f099434efc60d713172ea0b45920b58fd8e03405562b36c1cc2953a","observation_id":"8fb15b68-72f8-48fa-9d00-88093d78969a","resolution":{"observed_at":"2026-08-06T23:34:40.386436Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T23:34:40.542795Z","title":"Deep reinforcement and infomax learning","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2506.17518","last_updated":"2025-06-20T23:47:04Z","snapshot_observed_at":"2026-08-10T10:35:48.301748Z","submitted_at":"2025-06-20T23:47:04Z","title":"A Survey of State Representation Learning for Deep Reinforcement Learning","version":1},"reference_index":94,"source":"arxiv_source","source_observed_at":"2026-08-06T23:34:40.542795Z"},"links":{"citing_paper":"/paper/2506.17518"},"observation_digest":"sha256:28b29a19026473040c1214eb0bcc2c45d0b932d9718cf6a5304f1acacc8cefe9","observation_id":"7fb0d396-eee1-45ca-8b00-4bfa7703e8e4","resolution":{"observed_at":"2026-08-06T23:34:40.542795Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T23:34:40.720190Z","title":"Multi-horizon representations with hierarchical forward models for reinforcement learning","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2506.17518","last_updated":"2025-06-20T23:47:04Z","snapshot_observed_at":"2026-08-10T10:35:48.301748Z","submitted_at":"2025-06-20T23:47:04Z","title":"A Survey of State Representation Learning for Deep Reinforcement Learning","version":1},"reference_index":95,"source":"arxiv_source","source_observed_at":"2026-08-06T23:34:40.720190Z"},"links":{"citing_paper":"/paper/2506.17518"},"observation_digest":"sha256:5f87f66f3ae22726be445f32c27382f8b13d1380d44ea87876bb654631c3bff4","observation_id":"934a1bf8-71fe-4c20-8892-6045ae85f9c7","resolution":{"observed_at":"2026-08-06T23:34:40.720190Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2403.13765","last_updated":"2024-03-20T17:28:17Z","snapshot_observed_at":"2026-08-13T00:49:17.798937Z","submitted_at":"2024-03-20T17:28:17Z","title":"Towards Principled Representation Learning from Videos for Reinforcement Learning","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2403.13765","snapshot_observed_at":"2026-08-06T23:34:40.760414Z","title":"Towards principled representation learning from videos for reinforcement learning, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.17518","last_updated":"2025-06-20T23:47:04Z","snapshot_observed_at":"2026-08-10T10:35:48.301748Z","submitted_at":"2025-06-20T23:47:04Z","title":"A Survey of State Representation Learning for Deep Reinforcement Learning","version":1},"reference_index":96,"source":"arxiv_source","source_observed_at":"2026-08-06T23:34:40.760414Z"},"links":{"cited_paper":"/paper/2403.13765","citing_paper":"/paper/2506.17518"},"observation_digest":"sha256:e26fabc171767d9bb865c3ade8416a480c16c3a1600ac906e6e0afad453df4f9","observation_id":"248ddb6e-8d6f-42f7-9245-1ea4c28fb5c0","resolution":{"observed_at":"2026-08-06T23:34:40.760414Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1312.5602","last_updated":"2013-12-19T16:00:08Z","snapshot_observed_at":"2026-08-14T03:19:40.736445Z","submitted_at":"2013-12-19T16:00:08Z","title":"Playing Atari with Deep Reinforcement Learning","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1312.5602","snapshot_observed_at":"2026-08-06T23:34:40.865066Z","title":"Riedmiller","venue":null,"work_id":null,"year":2013},"citing_paper":{"arxiv_id":"2506.17518","last_updated":"2025-06-20T23:47:04Z","snapshot_observed_at":"2026-08-10T10:35:48.301748Z","submitted_at":"2025-06-20T23:47:04Z","title":"A Survey of State Representation Learning for Deep Reinforcement Learning","version":1},"reference_index":97,"source":"arxiv_source","source_observed_at":"2026-08-06T23:34:40.865066Z"},"links":{"cited_paper":"/paper/1312.5602","citing_paper":"/paper/2506.17518"},"observation_digest":"sha256:93fe7eb7e2731dab8cf9b46ef7d6e580fffcdc46b8e51ef0e56b45f5a09e364f","observation_id":"0f6b23f9-3eb1-4c57-9a74-015de97bc54f","resolution":{"observed_at":"2026-08-06T23:34:40.865066Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1906.02500","last_updated":"2019-06-06T10:02:52Z","snapshot_observed_at":"2026-08-14T16:19:57.327249Z","submitted_at":"2019-06-06T10:02:52Z","title":"Towards Interpretable Reinforcement Learning Using Attention Augmented Agents","version":1},"cited_work":{"arxiv_id":"1906.02500","doi":null,"metadata_source":"pith","pith_arxiv_id":"1906.02500","snapshot_observed_at":"2026-08-06T23:34:48.205298Z","title":"Towards Interpretable Reinforcement Learning Using Attention Augmented Agents","venue":"cs.LG","work_id":"2168d75b-1a8d-4e42-9c38-617b5a5d2525","year":2019},"citing_paper":{"arxiv_id":"2506.17518","last_updated":"2025-06-20T23:47:04Z","snapshot_observed_at":"2026-08-10T10:35:48.301748Z","submitted_at":"2025-06-20T23:47:04Z","title":"A Survey of State Representation Learning for Deep Reinforcement Learning","version":1},"reference_index":98,"source":"arxiv_source","source_observed_at":"2026-08-06T23:34:40.942699Z"},"links":{"cited_paper":"/paper/1906.02500","citing_paper":"/paper/2506.17518"},"observation_digest":"sha256:55e2ef0c4382f556296d05dac62e2e321dbf3b42db82f28b1cf362cac55aa769","observation_id":"c766b3fe-7979-4301-9978-5fffa20c34fb","resolution":{"observed_at":"2026-08-06T23:34:48.339822Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T23:34:41.037102Z","title":"R3m: A universal visual representation for robot manipulation, 2022","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2506.17518","last_updated":"2025-06-20T23:47:04Z","snapshot_observed_at":"2026-08-10T10:35:48.301748Z","submitted_at":"2025-06-20T23:47:04Z","title":"A Survey of State Representation Learning for Deep Reinforcement Learning","version":1},"reference_index":99,"source":"arxiv_source","source_observed_at":"2026-08-06T23:34:41.037102Z"},"links":{"citing_paper":"/paper/2506.17518"},"observation_digest":"sha256:d0244665a258edbfe0b40fa21c53111781f27a0c103734fdfab17363502add92","observation_id":"ea189003-f8f4-4171-ab06-f01a02fe996c","resolution":{"observed_at":"2026-08-06T23:34:41.037102Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T23:34:41.090842Z","title":"Bridging state and history representations: Understanding self-predictive rl, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.17518","last_updated":"2025-06-20T23:47:04Z","snapshot_observed_at":"2026-08-10T10:35:48.301748Z","submitted_at":"2025-06-20T23:47:04Z","title":"A Survey of State Representation Learning for Deep Reinforcement Learning","version":1},"reference_index":100,"source":"arxiv_source","source_observed_at":"2026-08-06T23:34:41.090842Z"},"links":{"citing_paper":"/paper/2506.17518"},"observation_digest":"sha256:b1a0dded2d1f22ec143396b4fb1b7b24f7df71cc788e0ca80ea17faa8da325a1","observation_id":"ca1dcd19-da73-42e5-960c-7d4f0b9a39e0","resolution":{"observed_at":"2026-08-06T23:34:41.090842Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T23:34:41.099059Z","title":"Foundation policies with H ilbert representations","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.17518","last_updated":"2025-06-20T23:47:04Z","snapshot_observed_at":"2026-08-10T10:35:48.301748Z","submitted_at":"2025-06-20T23:47:04Z","title":"A Survey of State Representation Learning for Deep Reinforcement Learning","version":1},"reference_index":101,"source":"arxiv_source","source_observed_at":"2026-08-06T23:34:41.099059Z"},"links":{"citing_paper":"/paper/2506.17518"},"observation_digest":"sha256:52a83064f76bb9b8541f78e902c552193834241638cf8eaa6f2b01e2edb2d9a4","observation_id":"eb4a3993-ec1e-41fd-9423-4d58fd144a9c","resolution":{"observed_at":"2026-08-06T23:34:41.099059Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"paper":{"arxiv_id":"2506.17518","last_updated":"2025-06-20T23:47:04Z","latest_version":1,"primary_category":"cs.LG","snapshot_observed_at":"2026-08-10T10:35:48.301748Z","submitted_at":"2025-06-20T23:47:04Z","title":"A Survey of State Representation Learning for Deep Reinforcement Learning"},"reference_resolution":{"displayed":100,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":89,"verified_exact":11,"verified_fuzzy":0},"total_outbound_references":157},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"thesis":"As of 15 August 2026, this Paper Citation Record lists 100 of 157 outbound references and 7 inbound Pith citation observations for arXiv:2506.17518."}