{"as_of":"2026-08-10T14:36:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:7b96e1a0fb0559f61d3e016235e1c446f02fb1a90dc39ff13e7fb28d2e46b751","coverage":[{"denominator":71,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":71,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-09T19:18:45.195892Z","state":"measured"},{"denominator":82,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":82,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-10T06:31:04.303077+00:00","state":"measured"},{"denominator":11,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":11,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-08T04:20:17.721810Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"arxiv_reference","source_observed_at":"2026-07-04T06:29:37.304505Z","state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2502.00379","last_updated":"2025-06-12T16:28:52Z","snapshot_observed_at":"2026-08-10T10:34:42.717916Z","submitted_at":"2025-02-01T09:35:51Z","title":"Latent Action Learning Requires Supervision in the Presence of Distractors","version":5},"cited_work":{"arxiv_id":"2502.00379","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2502.00379","snapshot_observed_at":"2026-07-04T06:29:37.304505Z","title":"Latent action learning requires supervision in the presence of distractors","venue":null,"work_id":"353bfb92-f750-4c73-8c07-623ea6b242c4","year":2025},"citing_paper":{"arxiv_id":"2507.23682","last_updated":"2025-09-25T10:26:44Z","snapshot_observed_at":"2026-08-02T00:55:45.018424Z","submitted_at":"2025-07-31T15:57:46Z","title":"villa-X: Enhancing Latent Action Modeling in Vision-Language-Action Models","version":3},"reference_index":50,"source":"pdf_text","source_observed_at":"2026-05-15T21:52:02.893886Z"},"links":{"cited_paper":"/paper/2502.00379","citing_paper":"/paper/2507.23682"},"observation_digest":"sha256:502b9495330cf0f7705957716c7006ead58c8b7ef6e5efecc474aa1c76d72f5f","observation_id":"301818b8-9f18-4cf1-94c7-d2a9f2366766","resolution":{"observed_at":"2026-05-15T21:52:03.125800Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2502.00379","last_updated":"2025-06-12T16:28:52Z","snapshot_observed_at":"2026-08-10T10:34:42.717916Z","submitted_at":"2025-02-01T09:35:51Z","title":"Latent Action Learning Requires Supervision in the Presence of Distractors","version":5},"cited_work":{"arxiv_id":"2502.00379","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2502.00379","snapshot_observed_at":"2026-07-04T06:29:37.304505Z","title":"Latent action learning requires supervision in the presence of distractors","venue":null,"work_id":"353bfb92-f750-4c73-8c07-623ea6b242c4","year":2025},"citing_paper":{"arxiv_id":"2512.13030","last_updated":"2025-12-25T08:16:05Z","snapshot_observed_at":"2026-07-06T22:38:59.725645Z","submitted_at":"2025-12-15T06:58:40Z","title":"Motus: A Unified Latent Action World Model","version":2},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-05-12T18:44:36.636455Z"},"links":{"cited_paper":"/paper/2502.00379","citing_paper":"/paper/2512.13030"},"observation_digest":"sha256:3da4775ac8fe32c372b0e8b4597e0fa8fb43f0de02a5f9a8d12097d2c254305f","observation_id":"ad354d01-a37a-411f-95fc-047e17c463e2","resolution":{"observed_at":"2026-05-12T18:44:36.795667Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2502.00379","last_updated":"2025-06-12T16:28:52Z","snapshot_observed_at":"2026-08-10T10:34:42.717916Z","submitted_at":"2025-02-01T09:35:51Z","title":"Latent Action Learning Requires Supervision in the Presence of Distractors","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2502.00379","snapshot_observed_at":"2026-08-02T22:41:10.188157Z","title":"Latent action learning requires supervision in the presence of distrac- tors.arXiv preprint arXiv:2502.00379,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2602.16229","last_updated":"2026-05-25T05:51:24Z","snapshot_observed_at":"2026-08-09T05:14:54.152823Z","submitted_at":"2026-02-18T07:08:14Z","title":"Factored Latent Action World Models","version":2},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-02T22:41:10.188157Z"},"links":{"cited_paper":"/paper/2502.00379","citing_paper":"/paper/2602.16229"},"observation_digest":"sha256:c5926affe41ff02ccb199e4013c41ba1f963d05337001ba269a01ed82c075501","observation_id":"085efc38-a393-4620-92df-15e089046415","resolution":{"observed_at":"2026-08-02T22:41:10.188157Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2502.00379","last_updated":"2025-06-12T16:28:52Z","snapshot_observed_at":"2026-08-10T10:34:42.717916Z","submitted_at":"2025-02-01T09:35:51Z","title":"Latent Action Learning Requires Supervision in the Presence of Distractors","version":5},"cited_work":{"arxiv_id":"2502.00379","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2502.00379","snapshot_observed_at":"2026-07-04T06:29:37.304505Z","title":"Latent action learning requires supervision in the presence of distractors","venue":null,"work_id":"353bfb92-f750-4c73-8c07-623ea6b242c4","year":2025},"citing_paper":{"arxiv_id":"2605.04678","last_updated":"2026-05-06T09:27:07Z","snapshot_observed_at":"2026-07-06T23:17:23.641984Z","submitted_at":"2026-05-06T09:27:07Z","title":"From Pixels to Tokens: A Systematic Study of Latent Action Supervision for Vision-Language-Action Models","version":1},"reference_index":28,"source":"arxiv_source","source_observed_at":"2026-05-08T17:43:00.453164Z"},"links":{"cited_paper":"/paper/2502.00379","citing_paper":"/paper/2605.04678"},"observation_digest":"sha256:b2df61c7fc5ee46d1fe4941f62a1d7f8cc0ef4b7af7fcec759ec21dd58703a98","observation_id":"52e8f481-8acf-4981-a12e-a88485009d5e","resolution":{"observed_at":"2026-05-11T17:16:09.822818Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2502.00379","last_updated":"2025-06-12T16:28:52Z","snapshot_observed_at":"2026-08-10T10:34:42.717916Z","submitted_at":"2025-02-01T09:35:51Z","title":"Latent Action Learning Requires Supervision in the Presence of Distractors","version":5},"cited_work":{"arxiv_id":"2502.00379","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2502.00379","snapshot_observed_at":"2026-07-04T06:29:37.304505Z","title":"Latent action learning requires supervision in the presence of distractors","venue":null,"work_id":"353bfb92-f750-4c73-8c07-623ea6b242c4","year":2025},"citing_paper":{"arxiv_id":"2606.04130","last_updated":"2026-06-02T18:40:24Z","snapshot_observed_at":"2026-07-06T23:44:19.059079Z","submitted_at":"2026-06-02T18:40:24Z","title":"CLAW: Learning Continuous Latent Action World Models via Adversarial Latent Regularization","version":1},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-06-28T09:55:00.402411Z"},"links":{"cited_paper":"/paper/2502.00379","citing_paper":"/paper/2606.04130"},"observation_digest":"sha256:7cc808998494cfaf1a2894e1416f29720e9d30656922b9ace35c089988bf8ce0","observation_id":"7d3440b3-788d-4625-95fd-3e6d9cb29b27","resolution":{"observed_at":"2026-07-02T03:36:29.593558Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2502.00379","last_updated":"2025-06-12T16:28:52Z","snapshot_observed_at":"2026-08-10T10:34:42.717916Z","submitted_at":"2025-02-01T09:35:51Z","title":"Latent Action Learning Requires Supervision in the Presence of Distractors","version":5},"cited_work":{"arxiv_id":"2502.00379","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2502.00379","snapshot_observed_at":"2026-07-04T06:29:37.304505Z","title":"Latent action learning requires supervision in the presence of distractors","venue":null,"work_id":"353bfb92-f750-4c73-8c07-623ea6b242c4","year":2025},"citing_paper":{"arxiv_id":"2606.07100","last_updated":"2026-06-30T09:11:02Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2026-06-05T09:51:25Z","title":"LARA: Latent Action Representation Alignment for Vision-Language-Action Models","version":1},"reference_index":9,"source":"arxiv_source","source_observed_at":"2026-06-27T22:25:17.522240Z"},"links":{"cited_paper":"/paper/2502.00379","citing_paper":"/paper/2606.07100"},"observation_digest":"sha256:c1b1760da687b71f56c870b66f64b79d70a31c0608c1d4d4e0d09b08f98c832b","observation_id":"8e458f73-de16-4a2f-a076-142770202e66","resolution":{"observed_at":"2026-07-02T16:47:09.551839Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2502.00379","last_updated":"2025-06-12T16:28:52Z","snapshot_observed_at":"2026-08-10T10:34:42.717916Z","submitted_at":"2025-02-01T09:35:51Z","title":"Latent Action Learning Requires Supervision in the Presence of Distractors","version":5},"cited_work":{"arxiv_id":"2502.00379","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2502.00379","snapshot_observed_at":"2026-07-04T06:29:37.304505Z","title":"Latent action learning requires supervision in the presence of distractors","venue":null,"work_id":"353bfb92-f750-4c73-8c07-623ea6b242c4","year":2025},"citing_paper":{"arxiv_id":"2606.07100","last_updated":"2026-06-30T09:11:02Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2026-06-05T09:51:25Z","title":"LARA: Latent Action Representation Alignment for Vision-Language-Action Models","version":2},"reference_index":9,"source":"arxiv_source","source_observed_at":"2026-07-01T07:17:42.045939Z"},"links":{"cited_paper":"/paper/2502.00379","citing_paper":"/paper/2606.07100"},"observation_digest":"sha256:a7abdafb5c87b9944bf016a8d02706de8e44640192b9869eb8e339aa818ae5fb","observation_id":"3645caf0-e88c-4cfd-ac50-1b2530f0c3a3","resolution":{"observed_at":"2026-07-01T08:35:34.470694Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2502.00379","last_updated":"2025-06-12T16:28:52Z","snapshot_observed_at":"2026-08-10T10:34:42.717916Z","submitted_at":"2025-02-01T09:35:51Z","title":"Latent Action Learning Requires Supervision in the Presence of Distractors","version":5},"cited_work":{"arxiv_id":"2502.00379","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2502.00379","snapshot_observed_at":"2026-07-04T06:29:37.304505Z","title":"Latent action learning requires supervision in the presence of distractors","venue":null,"work_id":"353bfb92-f750-4c73-8c07-623ea6b242c4","year":2025},"citing_paper":{"arxiv_id":"2606.21139","last_updated":"2026-06-19T06:24:05Z","snapshot_observed_at":"2026-08-08T10:51:24.514991Z","submitted_at":"2026-06-19T06:24:05Z","title":"PoLAR: Factorizing Extent and Mode in Latent Actions for Robot Policy Learning","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-06-26T14:28:36.505775Z"},"links":{"cited_paper":"/paper/2502.00379","citing_paper":"/paper/2606.21139"},"observation_digest":"sha256:a9c67cb1b2630ac40f7a8d51fe774406468d4f8559cf1907f505033aaa6f41f7","observation_id":"74690e68-9251-4c81-9edc-1652f415ed36","resolution":{"observed_at":"2026-07-04T06:29:37.306210Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2502.00379","last_updated":"2025-06-12T16:28:52Z","snapshot_observed_at":"2026-08-10T10:34:42.717916Z","submitted_at":"2025-02-01T09:35:51Z","title":"Latent Action Learning Requires Supervision in the Presence of Distractors","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2502.00379","snapshot_observed_at":"2026-08-02T03:25:28.125862Z","title":"Latent action learning requires supervision in the presence of distractors","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.14183","last_updated":"2026-07-18T10:02:02Z","snapshot_observed_at":"2026-08-07T01:27:34.322710Z","submitted_at":"2026-07-15T14:49:49Z","title":"Open-AoE: An Open Egocentric Manipulation Dataset and Toolchain for Embodied Learning","version":2},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-08-02T03:25:28.125862Z"},"links":{"cited_paper":"/paper/2502.00379","citing_paper":"/paper/2607.14183"},"observation_digest":"sha256:8e4ac1b688803c1c5339c7a8fd16feedf1bcafcfe63fd02bd08784ee626c7990","observation_id":"eac3cf50-2da4-4748-900e-3da0791c31c5","resolution":{"observed_at":"2026-08-02T03:25:28.125862Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2502.00379","last_updated":"2025-06-12T16:28:52Z","snapshot_observed_at":"2026-08-10T10:34:42.717916Z","submitted_at":"2025-02-01T09:35:51Z","title":"Latent Action Learning Requires Supervision in the Presence of Distractors","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2502.00379","snapshot_observed_at":"2026-08-01T11:31:03.497846Z","title":"& Others Latent Action Learning Requires Supervision in the Presence of Distractors.ArXiv Preprint ArXiv:2502.00379","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.19889","last_updated":"2026-07-22T08:20:52Z","snapshot_observed_at":"2026-08-08T10:17:50.117528Z","submitted_at":"2026-07-22T08:20:52Z","title":"LAVIFT: Latent-Action-Guided Vision Fine-Tuning for Surgical Interaction Recognition","version":1},"reference_index":73,"source":"pdf_text","source_observed_at":"2026-08-01T11:31:03.497846Z"},"links":{"cited_paper":"/paper/2502.00379","citing_paper":"/paper/2607.19889"},"observation_digest":"sha256:934b31f88ece0d8835afa45eeb26d513509413b6ae1f74cf287e7ebcefcb5d26","observation_id":"15d0a409-e572-43cb-b595-e8bad66dc626","resolution":{"observed_at":"2026-08-01T11:31:03.497846Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2502.00379","last_updated":"2025-06-12T16:28:52Z","snapshot_observed_at":"2026-08-10T10:34:42.717916Z","submitted_at":"2025-02-01T09:35:51Z","title":"Latent Action Learning Requires Supervision in the Presence of Distractors","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2502.00379","snapshot_observed_at":"2026-08-08T04:20:17.721810Z","title":"Latent action learning requires supervision in the presence of distractors.arXiv preprint arXiv:2502.00379, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2608.05674","last_updated":"2026-08-06T07:14:55Z","snapshot_observed_at":"2026-08-09T23:11:20.481140Z","submitted_at":"2026-08-06T07:14:55Z","title":"JoyAI-RA 0.5: Scaling Robot Manipulation Learning via Dual Action Alignment","version":1},"reference_index":44,"source":"pdf_text","source_observed_at":"2026-08-08T04:20:17.721810Z"},"links":{"cited_paper":"/paper/2502.00379","citing_paper":"/paper/2608.05674"},"observation_digest":"sha256:641cf55d73e1e0af0dc0207411957986c4b685512e304e086f7c2656b1194f13","observation_id":"67d6486f-d4e1-4932-bd3d-51e284061543","resolution":{"observed_at":"2026-08-08T04:20:17.721810Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"links":{"evidence":"/evidence","html":"/paper/2502.00379/citation-record","integrity":"/paper/2502.00379/integrity","json":"/paper/2502.00379/citation-record.json","paper":"/paper/2502.00379"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T19:18:44.616333Z","title":"write newline","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2502.00379","last_updated":"2025-06-12T16:28:52Z","snapshot_observed_at":"2026-08-10T10:34:42.717916Z","submitted_at":"2025-02-01T09:35:51Z","title":"Latent Action Learning Requires Supervision in the Presence of Distractors","version":5},"reference_index":1,"source":"arxiv_source","source_observed_at":"2026-08-09T19:18:44.616333Z"},"links":{"citing_paper":"/paper/2502.00379"},"observation_digest":"sha256:b3c200ef6253ef82e5c9e00dd61f455d50db3b312f66b993fcdc1914891c65a7","observation_id":"f727a6c0-cdbc-485f-b477-4a86efdf4a23","resolution":{"observed_at":"2026-08-09T19:18:44.616333Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1610.01644","last_updated":"2018-11-22T23:40:00Z","snapshot_observed_at":"2026-08-09T22:50:03.459615Z","submitted_at":"2016-10-05T20:59:01Z","title":"Understanding intermediate layers using linear classifier probes","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1610.01644","snapshot_observed_at":"2026-08-09T19:18:44.681015Z","title":"Understanding intermediate layers using linear classifier probes","venue":null,"work_id":null,"year":2016},"citing_paper":{"arxiv_id":"2502.00379","last_updated":"2025-06-12T16:28:52Z","snapshot_observed_at":"2026-08-10T10:34:42.717916Z","submitted_at":"2025-02-01T09:35:51Z","title":"Latent Action Learning Requires Supervision in the Presence of Distractors","version":5},"reference_index":2,"source":"arxiv_source","source_observed_at":"2026-08-09T19:18:44.681015Z"},"links":{"cited_paper":"/paper/1610.01644","citing_paper":"/paper/2502.00379"},"observation_digest":"sha256:7a619f148f00986cbf315103303ab45ae283438c34a0c4a8a718d1e0ad40aa5e","observation_id":"20457c54-18ff-4dd8-909d-fbb96efd1522","resolution":{"observed_at":"2026-08-09T19:18:44.681015Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2405.17416","last_updated":"2024-07-16T17:57:46Z","snapshot_observed_at":"2026-08-09T23:26:37.752060Z","submitted_at":"2024-05-27T17:58:23Z","title":"A Recipe for Unbounded Data Augmentation in Visual Reinforcement Learning","version":2},"cited_work":{"arxiv_id":"2405.17416","doi":null,"metadata_source":"pith","pith_arxiv_id":"2405.17416","snapshot_observed_at":"2026-08-09T19:18:45.887594Z","title":"A Recipe for Unbounded Data Augmentation in Visual Reinforcement Learning","venue":"cs.LG","work_id":"24c93a6e-71db-4373-8370-576079a67a78","year":2024},"citing_paper":{"arxiv_id":"2502.00379","last_updated":"2025-06-12T16:28:52Z","snapshot_observed_at":"2026-08-10T10:34:42.717916Z","submitted_at":"2025-02-01T09:35:51Z","title":"Latent Action Learning Requires Supervision in the Presence of Distractors","version":5},"reference_index":3,"source":"arxiv_source","source_observed_at":"2026-08-09T19:18:44.765069Z"},"links":{"cited_paper":"/paper/2405.17416","citing_paper":"/paper/2502.00379"},"observation_digest":"sha256:ccdb052c4d93df6d6beb4ef0e247e9534f67ec3ce2091b79832fe9de24559c95","observation_id":"9229e970-1843-4dba-899a-a295bfecf025","resolution":{"observed_at":"2026-08-09T19:18:45.892893Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T19:18:46.401032Z","title":"Playing hard exploration games by watching youtube","venue":null,"work_id":"f4140ae7-589e-4c90-b601-4fa93333dac0","year":2018},"citing_paper":{"arxiv_id":"2502.00379","last_updated":"2025-06-12T16:28:52Z","snapshot_observed_at":"2026-08-10T10:34:42.717916Z","submitted_at":"2025-02-01T09:35:51Z","title":"Latent Action Learning Requires Supervision in the Presence of Distractors","version":5},"reference_index":4,"source":"arxiv_source","source_observed_at":"2026-08-09T19:18:44.848806Z"},"links":{"citing_paper":"/paper/2502.00379"},"observation_digest":"sha256:72eea81e9396faaff44a8cca4d411b8e5bc5e7db218a59cff82c5a61da0518ff","observation_id":"1a729674-7f3e-4f2e-b2f6-8015ca624f71","resolution":{"observed_at":"2026-08-09T19:18:46.406080Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T19:18:46.384961Z","title":"Video pretraining (vpt): Learning to act by watching unlabeled online videos","venue":null,"work_id":"09c6a08d-f151-4a32-a276-0d9a294f7ced","year":2022},"citing_paper":{"arxiv_id":"2502.00379","last_updated":"2025-06-12T16:28:52Z","snapshot_observed_at":"2026-08-10T10:34:42.717916Z","submitted_at":"2025-02-01T09:35:51Z","title":"Latent Action Learning Requires Supervision in the Presence of Distractors","version":5},"reference_index":5,"source":"arxiv_source","source_observed_at":"2026-08-09T19:18:44.854314Z"},"links":{"citing_paper":"/paper/2502.00379"},"observation_digest":"sha256:0455dbeadd4bceba3c35654db693c9abe97061d69ed08e625e9b7b6eaae8de94","observation_id":"1b5212c1-e794-441a-97b3-a90241d67ee4","resolution":{"observed_at":"2026-08-09T19:18:46.389894Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2410.07441","last_updated":"2025-08-11T23:25:36Z","snapshot_observed_at":"2026-08-09T23:26:42.067180Z","submitted_at":"2024-10-09T21:14:09Z","title":"Zero-Shot Generalization of Vision-Based RL Without Data Augmentation","version":2},"cited_work":{"arxiv_id":"2410.07441","doi":null,"metadata_source":"pith","pith_arxiv_id":"2410.07441","snapshot_observed_at":"2026-08-09T19:18:45.863221Z","title":"Zero-Shot Generalization of Vision-Based RL Without Data Augmentation","venue":"cs.LG","work_id":"a39b7b3b-e528-4ed4-9280-632c83918a25","year":2024},"citing_paper":{"arxiv_id":"2502.00379","last_updated":"2025-06-12T16:28:52Z","snapshot_observed_at":"2026-08-10T10:34:42.717916Z","submitted_at":"2025-02-01T09:35:51Z","title":"Latent Action Learning Requires Supervision in the Presence of Distractors","version":5},"reference_index":6,"source":"arxiv_source","source_observed_at":"2026-08-09T19:18:44.859690Z"},"links":{"cited_paper":"/paper/2410.07441","citing_paper":"/paper/2502.00379"},"observation_digest":"sha256:7b26e0b8263b406404c809e6c8d2a693b2c67f5406fb101ddc25945f9fb89dad","observation_id":"cd7b46fd-8776-42f4-bfec-6214aeaa3d29","resolution":{"observed_at":"2026-08-09T19:18:45.869119Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T19:18:46.368643Z","title":"Look where you look! saliency-guided q-networks for generalization in visual reinforcement learning","venue":null,"work_id":"ae87a534-a487-47a1-a417-78b1c43b91ee","year":2022},"citing_paper":{"arxiv_id":"2502.00379","last_updated":"2025-06-12T16:28:52Z","snapshot_observed_at":"2026-08-10T10:34:42.717916Z","submitted_at":"2025-02-01T09:35:51Z","title":"Latent Action Learning Requires Supervision in the Presence of Distractors","version":5},"reference_index":7,"source":"arxiv_source","source_observed_at":"2026-08-09T19:18:44.865322Z"},"links":{"citing_paper":"/paper/2502.00379"},"observation_digest":"sha256:df8cd078c626ea35fa19cab6f5bdef5a742d0b23050035797087f5b63f68ff95","observation_id":"8d4d7a1f-9df4-46fc-8e6d-4e031334c672","resolution":{"observed_at":"2026-08-09T19:18:46.374263Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1902.05605","last_updated":"2024-03-25T10:20:18Z","snapshot_observed_at":"2026-08-03T12:33:55.627333Z","submitted_at":"2019-02-14T21:05:50Z","title":"CrossQ: Batch Normalization in Deep Reinforcement Learning for Greater Sample Efficiency and Simplicity","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1902.05605","snapshot_observed_at":"2026-08-09T19:18:44.870942Z","title":"Crossq: Batch normalization in deep reinforcement learning for greater sample efficiency and simplicity","venue":null,"work_id":null,"year":1902},"citing_paper":{"arxiv_id":"2502.00379","last_updated":"2025-06-12T16:28:52Z","snapshot_observed_at":"2026-08-10T10:34:42.717916Z","submitted_at":"2025-02-01T09:35:51Z","title":"Latent Action Learning Requires Supervision in the Presence of Distractors","version":5},"reference_index":8,"source":"arxiv_source","source_observed_at":"2026-08-09T19:18:44.870942Z"},"links":{"cited_paper":"/paper/1902.05605","citing_paper":"/paper/2502.00379"},"observation_digest":"sha256:874d9864e9b11a23dcc609ac204653cc11e53c58c143a9b30581d8c64ecf8119","observation_id":"6d558e1a-6383-43cb-bb04-6ab26cb2f257","resolution":{"observed_at":"2026-08-09T19:18:44.870942Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T19:18:46.352602Z","title":"D., Edwards, A., Parker-Holder, J., Shi, Y., Hughes, E., Lai, M., Mavalankar, A., Steigerwald, R., Apps, C., et al","venue":null,"work_id":"1556023e-c8e6-4e29-afed-d4b1966069ae","year":2024},"citing_paper":{"arxiv_id":"2502.00379","last_updated":"2025-06-12T16:28:52Z","snapshot_observed_at":"2026-08-10T10:34:42.717916Z","submitted_at":"2025-02-01T09:35:51Z","title":"Latent Action Learning Requires Supervision in the Presence of Distractors","version":5},"reference_index":9,"source":"arxiv_source","source_observed_at":"2026-08-09T19:18:44.876507Z"},"links":{"citing_paper":"/paper/2502.00379"},"observation_digest":"sha256:a0235a1ccc04fe4183b2dd2182db31cc8310b77ed493455655cf570471c8f6bb","observation_id":"c2e053af-df5e-47cd-847b-5e2e12064475","resolution":{"observed_at":"2026-08-09T19:18:46.357942Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2405.15083","last_updated":"2024-05-23T22:09:01Z","snapshot_observed_at":"2026-07-06T18:19:00.169416Z","submitted_at":"2024-05-23T22:09:01Z","title":"MuDreamer: Learning Predictive World Models without Reconstruction","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2405.15083","snapshot_observed_at":"2026-08-09T19:18:44.882853Z","title":"and Timofte, R","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2502.00379","last_updated":"2025-06-12T16:28:52Z","snapshot_observed_at":"2026-08-10T10:34:42.717916Z","submitted_at":"2025-02-01T09:35:51Z","title":"Latent Action Learning Requires Supervision in the Presence of Distractors","version":5},"reference_index":10,"source":"arxiv_source","source_observed_at":"2026-08-09T19:18:44.882853Z"},"links":{"cited_paper":"/paper/2405.15083","citing_paper":"/paper/2502.00379"},"observation_digest":"sha256:7d648992da88a5ca806fdc672ead4b0a95486ecceb0e842394b0efdcfa52015c","observation_id":"bfccaa5d-0da5-4393-8557-054cf12871e8","resolution":{"observed_at":"2026-08-09T19:18:44.882853Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T19:18:44.888341Z","title":"and He, K","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2502.00379","last_updated":"2025-06-12T16:28:52Z","snapshot_observed_at":"2026-08-10T10:34:42.717916Z","submitted_at":"2025-02-01T09:35:51Z","title":"Latent Action Learning Requires Supervision in the Presence of Distractors","version":5},"reference_index":11,"source":"arxiv_source","source_observed_at":"2026-08-09T19:18:44.888341Z"},"links":{"citing_paper":"/paper/2502.00379"},"observation_digest":"sha256:e5661751ff9741888005a826471fcbf5499dd15643662e1931a7048560e5cba3","observation_id":"7a68f502-41da-4904-9131-b6ff1dcdfd1c","resolution":{"observed_at":"2026-08-09T19:18:44.888341Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2411.00785","last_updated":"2024-10-17T13:41:16Z","snapshot_observed_at":"2026-07-06T19:43:42.287026Z","submitted_at":"2024-10-17T13:41:16Z","title":"IGOR: Image-GOal Representations are the Atomic Control Units for Foundation Models in Embodied AI","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2411.00785","snapshot_observed_at":"2026-08-09T19:18:44.893686Z","title":"C., Zhao, L., and Bian, J","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2502.00379","last_updated":"2025-06-12T16:28:52Z","snapshot_observed_at":"2026-08-10T10:34:42.717916Z","submitted_at":"2025-02-01T09:35:51Z","title":"Latent Action Learning Requires Supervision in the Presence of Distractors","version":5},"reference_index":12,"source":"arxiv_source","source_observed_at":"2026-08-09T19:18:44.893686Z"},"links":{"cited_paper":"/paper/2411.00785","citing_paper":"/paper/2502.00379"},"observation_digest":"sha256:e2d3b260e6b0859eb020299b8ee810d78c30c586bd5928053d7c4a5b7e9b1b1a","observation_id":"767b7ea1-b712-411a-9dc9-a8626f3ec87f","resolution":{"observed_at":"2026-08-09T19:18:44.893686Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T19:18:44.899440Z","title":"Moto: Latent motion token as the bridging language for robot manipulation","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2502.00379","last_updated":"2025-06-12T16:28:52Z","snapshot_observed_at":"2026-08-10T10:34:42.717916Z","submitted_at":"2025-02-01T09:35:51Z","title":"Latent Action Learning Requires Supervision in the Presence of Distractors","version":5},"reference_index":13,"source":"arxiv_source","source_observed_at":"2026-08-09T19:18:44.899440Z"},"links":{"citing_paper":"/paper/2502.00379"},"observation_digest":"sha256:fd0bad871819fee11865e84b88b69d5d824abb733ef45e02a445c468003f79e2","observation_id":"4b729286-04e5-411f-9733-014ced324f47","resolution":{"observed_at":"2026-08-09T19:18:44.899440Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T19:18:46.325406Z","title":"Leveraging procedural generation to benchmark reinforcement learning","venue":null,"work_id":"6565d721-696a-4ae8-a649-fc86a33f4c9c","year":2020},"citing_paper":{"arxiv_id":"2502.00379","last_updated":"2025-06-12T16:28:52Z","snapshot_observed_at":"2026-08-10T10:34:42.717916Z","submitted_at":"2025-02-01T09:35:51Z","title":"Latent Action Learning Requires Supervision in the Presence of Distractors","version":5},"reference_index":14,"source":"arxiv_source","source_observed_at":"2026-08-09T19:18:44.905633Z"},"links":{"citing_paper":"/paper/2502.00379"},"observation_digest":"sha256:107ca258bc9fada2c05e9d855b40585796290c69d6848f67f67bf1c23b3da099","observation_id":"738e08e7-b7a2-4d9f-88db-68a469572bb6","resolution":{"observed_at":"2026-08-09T19:18:46.330471Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2409.12192","last_updated":"2024-10-30T18:48:00Z","snapshot_observed_at":"2026-08-08T15:23:46.399280Z","submitted_at":"2024-09-18T17:59:43Z","title":"DynaMo: In-Domain Dynamics Pretraining for Visuo-Motor Control","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2409.12192","snapshot_observed_at":"2026-08-09T19:18:44.910833Z","title":"J., Pan, H., Iyer, A., Haldar, S., and Pinto, L","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2502.00379","last_updated":"2025-06-12T16:28:52Z","snapshot_observed_at":"2026-08-10T10:34:42.717916Z","submitted_at":"2025-02-01T09:35:51Z","title":"Latent Action Learning Requires Supervision in the Presence of Distractors","version":5},"reference_index":15,"source":"arxiv_source","source_observed_at":"2026-08-09T19:18:44.910833Z"},"links":{"cited_paper":"/paper/2409.12192","citing_paper":"/paper/2502.00379"},"observation_digest":"sha256:4151f7bc8c534fa6032a84c38a07d338959f3877f322aef3a9374fde311572b2","observation_id":"3b030eb7-2d58-47a4-a126-9588f4679459","resolution":{"observed_at":"2026-08-09T19:18:44.910833Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T19:18:46.309495Z","title":"Dreamerpro: Reconstruction-free model-based reinforcement learning with prototypical representations","venue":null,"work_id":"cb9a27cf-79d7-486e-9fdd-680f9c14cfd3","year":2022},"citing_paper":{"arxiv_id":"2502.00379","last_updated":"2025-06-12T16:28:52Z","snapshot_observed_at":"2026-08-10T10:34:42.717916Z","submitted_at":"2025-02-01T09:35:51Z","title":"Latent Action Learning Requires Supervision in the Presence of Distractors","version":5},"reference_index":16,"source":"arxiv_source","source_observed_at":"2026-08-09T19:18:44.915999Z"},"links":{"citing_paper":"/paper/2502.00379"},"observation_digest":"sha256:2673f04414a4f61a92f16ce17fa75f262c6906b24af52817e09592784763542b","observation_id":"4082919d-a620-47de-a58b-b4667dbad494","resolution":{"observed_at":"2026-08-09T19:18:46.314539Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T19:18:46.294150Z","title":"Imitating latent policies from observation","venue":null,"work_id":"7a1c602c-5fa9-4f6c-9f3c-9248e43fea7b","year":2019},"citing_paper":{"arxiv_id":"2502.00379","last_updated":"2025-06-12T16:28:52Z","snapshot_observed_at":"2026-08-10T10:34:42.717916Z","submitted_at":"2025-02-01T09:35:51Z","title":"Latent Action Learning Requires Supervision in the Presence of Distractors","version":5},"reference_index":17,"source":"arxiv_source","source_observed_at":"2026-08-09T19:18:44.920953Z"},"links":{"citing_paper":"/paper/2502.00379"},"observation_digest":"sha256:1907ac319a5f8900eea55f4a72db3b31831fc93fe7d8aab7133e24b2115fe058","observation_id":"2b876b85-14ff-4f60-a83f-c583da3ea6e1","resolution":{"observed_at":"2026-08-09T19:18:46.299099Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T19:18:46.277992Z","title":"Learning task informed abstractions","venue":null,"work_id":"52f0ef83-ed12-4bd3-8e26-9d35780491d7","year":2021},"citing_paper":{"arxiv_id":"2502.00379","last_updated":"2025-06-12T16:28:52Z","snapshot_observed_at":"2026-08-10T10:34:42.717916Z","submitted_at":"2025-02-01T09:35:51Z","title":"Latent Action Learning Requires Supervision in the Presence of Distractors","version":5},"reference_index":18,"source":"arxiv_source","source_observed_at":"2026-08-09T19:18:44.925893Z"},"links":{"citing_paper":"/paper/2502.00379"},"observation_digest":"sha256:848f3ab044b4ff0bc82319a8648bb62c57bc23efe31dbfc4cf9be13f71240507","observation_id":"b5bb7d39-2c04-42e1-a159-59878a3aa88b","resolution":{"observed_at":"2026-08-09T19:18:46.283348Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T19:18:46.263024Z","title":"A., and Levine, S","venue":null,"work_id":"5a080264-922e-48b9-bb7e-9cb437150c92","year":2023},"citing_paper":{"arxiv_id":"2502.00379","last_updated":"2025-06-12T16:28:52Z","snapshot_observed_at":"2026-08-10T10:34:42.717916Z","submitted_at":"2025-02-01T09:35:51Z","title":"Latent Action Learning Requires Supervision in the Presence of Distractors","version":5},"reference_index":19,"source":"arxiv_source","source_observed_at":"2026-08-09T19:18:44.930674Z"},"links":{"citing_paper":"/paper/2502.00379"},"observation_digest":"sha256:dff00c6e829aa3241a5fd9c783b2699c0a477a7eb2a245883e4d68b7f52a56fc","observation_id":"54e6c2d3-2ff6-464e-9c0b-099053981cde","resolution":{"observed_at":"2026-08-09T19:18:46.267910Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T19:18:44.935458Z","title":"Ego4d: Around the world in 3,000 hours of egocentric video","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2502.00379","last_updated":"2025-06-12T16:28:52Z","snapshot_observed_at":"2026-08-10T10:34:42.717916Z","submitted_at":"2025-02-01T09:35:51Z","title":"Latent Action Learning Requires Supervision in the Presence of Distractors","version":5},"reference_index":20,"source":"arxiv_source","source_observed_at":"2026-08-09T19:18:44.935458Z"},"links":{"citing_paper":"/paper/2502.00379"},"observation_digest":"sha256:40746d823514d4b22f638e524f2f5b7d66adecd6dec61c84a231cb6a0695615b","observation_id":"18eacc9a-b995-4c28-8a69-6cad84425ede","resolution":{"observed_at":"2026-08-09T19:18:44.935458Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T19:18:44.940282Z","title":"Soft actor-critic: Off-policy maximum entropy deep reinforcement learning with a stochastic actor","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2502.00379","last_updated":"2025-06-12T16:28:52Z","snapshot_observed_at":"2026-08-10T10:34:42.717916Z","submitted_at":"2025-02-01T09:35:51Z","title":"Latent Action Learning Requires Supervision in the Presence of Distractors","version":5},"reference_index":21,"source":"arxiv_source","source_observed_at":"2026-08-09T19:18:44.940282Z"},"links":{"citing_paper":"/paper/2502.00379"},"observation_digest":"sha256:363cea713285868754b5c4106b11286054b8dbe23188a785c4cfeeed1a66910b","observation_id":"7048d8ec-d858-4493-9331-dbcee0b10075","resolution":{"observed_at":"2026-08-09T19:18:44.940282Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T19:18:46.227929Z","title":"a schel, T., K \\","venue":null,"work_id":"d0664743-d765-476e-9281-a0bac235b7d1","year":2022},"citing_paper":{"arxiv_id":"2502.00379","last_updated":"2025-06-12T16:28:52Z","snapshot_observed_at":"2026-08-10T10:34:42.717916Z","submitted_at":"2025-02-01T09:35:51Z","title":"Latent Action Learning Requires Supervision in the Presence of Distractors","version":5},"reference_index":22,"source":"arxiv_source","source_observed_at":"2026-08-09T19:18:44.944828Z"},"links":{"citing_paper":"/paper/2502.00379"},"observation_digest":"sha256:5c72c546761f0f2c6a28b67ddb52b26068fb3f121db73e86eb897c22f5f2e3ea","observation_id":"ec4f0b82-7538-45da-b546-1a633df9494d","resolution":{"observed_at":"2026-08-09T19:18:46.232837Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T19:18:46.212502Z","title":"and Wang, X","venue":null,"work_id":"63df95a9-7e41-4da1-acd7-2606a9a04a46","year":2021},"citing_paper":{"arxiv_id":"2502.00379","last_updated":"2025-06-12T16:28:52Z","snapshot_observed_at":"2026-08-10T10:34:42.717916Z","submitted_at":"2025-02-01T09:35:51Z","title":"Latent Action Learning Requires Supervision in the Presence of Distractors","version":5},"reference_index":23,"source":"arxiv_source","source_observed_at":"2026-08-09T19:18:44.948905Z"},"links":{"citing_paper":"/paper/2502.00379"},"observation_digest":"sha256:e5ef3cc2840db61297d762b3526da18575831a8c04ceae6e66c180401b558cee","observation_id":"2ad92b11-38ea-4c61-9ebf-def93303abde","resolution":{"observed_at":"2026-08-09T19:18:46.217381Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T19:18:46.195788Z","title":"Stabilizing deep q-learning with convnets and vision transformers under data augmentation","venue":null,"work_id":"8a989ea8-5cae-45dc-8506-66d02e41e40a","year":2021},"citing_paper":{"arxiv_id":"2502.00379","last_updated":"2025-06-12T16:28:52Z","snapshot_observed_at":"2026-08-10T10:34:42.717916Z","submitted_at":"2025-02-01T09:35:51Z","title":"Latent Action Learning Requires Supervision in the Presence of Distractors","version":5},"reference_index":24,"source":"arxiv_source","source_observed_at":"2026-08-09T19:18:44.953288Z"},"links":{"citing_paper":"/paper/2502.00379"},"observation_digest":"sha256:cdf30906131f8ccd5040651cf8e9c3b1fb247c75fa1078744fb957a2e42db1fe","observation_id":"cab23eb4-6257-442e-af5f-5e8b3d66a7dc","resolution":{"observed_at":"2026-08-09T19:18:46.201046Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2203.04955","last_updated":"2022-07-19T18:14:36Z","snapshot_observed_at":"2026-07-06T12:46:08.838773Z","submitted_at":"2022-03-09T18:58:28Z","title":"Temporal Difference Learning for Model Predictive Control","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2203.04955","snapshot_observed_at":"2026-08-09T19:18:44.957482Z","title":"Temporal difference learning for model predictive control","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2502.00379","last_updated":"2025-06-12T16:28:52Z","snapshot_observed_at":"2026-08-10T10:34:42.717916Z","submitted_at":"2025-02-01T09:35:51Z","title":"Latent Action Learning Requires Supervision in the Presence of Distractors","version":5},"reference_index":25,"source":"arxiv_source","source_observed_at":"2026-08-09T19:18:44.957482Z"},"links":{"cited_paper":"/paper/2203.04955","citing_paper":"/paper/2502.00379"},"observation_digest":"sha256:4f3610718d387da55e2b21439f48940f13500e1a4856ba9dd6de3486faf89ab6","observation_id":"39a98327-8d10-468b-8af8-4b2691f3311a","resolution":{"observed_at":"2026-08-09T19:18:44.957482Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T19:18:44.962289Z","title":"Deep residual learning for image recognition","venue":null,"work_id":null,"year":2016},"citing_paper":{"arxiv_id":"2502.00379","last_updated":"2025-06-12T16:28:52Z","snapshot_observed_at":"2026-08-10T10:34:42.717916Z","submitted_at":"2025-02-01T09:35:51Z","title":"Latent Action Learning Requires Supervision in the Presence of Distractors","version":5},"reference_index":26,"source":"arxiv_source","source_observed_at":"2026-08-09T19:18:44.962289Z"},"links":{"citing_paper":"/paper/2502.00379"},"observation_digest":"sha256:a49071efa62daa794de95aa96ca073107ed8f3090bafb9c4fa4f9fd4051023ab","observation_id":"60d1fe61-9736-4cb1-8505-575edf6325cf","resolution":{"observed_at":"2026-08-09T19:18:44.962289Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T19:18:46.168238Z","title":null,"venue":null,"work_id":"dfa5e26f-43e2-43ad-8331-c4afeb9bf202","year":2022},"citing_paper":{"arxiv_id":"2502.00379","last_updated":"2025-06-12T16:28:52Z","snapshot_observed_at":"2026-08-10T10:34:42.717916Z","submitted_at":"2025-02-01T09:35:51Z","title":"Latent Action Learning Requires Supervision in the Presence of Distractors","version":5},"reference_index":27,"source":"arxiv_source","source_observed_at":"2026-08-09T19:18:44.966531Z"},"links":{"citing_paper":"/paper/2502.00379"},"observation_digest":"sha256:8a53c296d0f9e37e072b7e395a7767ca4fc171e678c9064b5acd6236baa656e8","observation_id":"03db232b-edb5-40e0-ada1-c06d78a8a30c","resolution":{"observed_at":"2026-08-09T19:18:46.173724Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T19:18:46.151090Z","title":"Spectrum random masking for generalization in image-based reinforcement learning","venue":null,"work_id":"ee15e237-64be-404f-a6a5-0bf57ed51e72","year":2022},"citing_paper":{"arxiv_id":"2502.00379","last_updated":"2025-06-12T16:28:52Z","snapshot_observed_at":"2026-08-10T10:34:42.717916Z","submitted_at":"2025-02-01T09:35:51Z","title":"Latent Action Learning Requires Supervision in the Presence of Distractors","version":5},"reference_index":28,"source":"arxiv_source","source_observed_at":"2026-08-09T19:18:44.971607Z"},"links":{"citing_paper":"/paper/2502.00379"},"observation_digest":"sha256:0f3245d931685a2bfc1eb99a0696ef9931b7a14104fc5f7a309a0c9717df996e","observation_id":"ba314408-6340-4ec4-a686-faa96f4d0128","resolution":{"observed_at":"2026-08-09T19:18:46.156130Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2211.00164","last_updated":"2023-08-14T00:16:23Z","snapshot_observed_at":"2026-08-06T02:43:13.210400Z","submitted_at":"2022-10-31T22:12:48Z","title":"Agent-Controller Representations: Principled Offline RL with Rich Exogenous Information","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2211.00164","snapshot_observed_at":"2026-08-09T19:18:44.976732Z","title":null,"venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2502.00379","last_updated":"2025-06-12T16:28:52Z","snapshot_observed_at":"2026-08-10T10:34:42.717916Z","submitted_at":"2025-02-01T09:35:51Z","title":"Latent Action Learning Requires Supervision in the Presence of Distractors","version":5},"reference_index":29,"source":"arxiv_source","source_observed_at":"2026-08-09T19:18:44.976732Z"},"links":{"cited_paper":"/paper/2211.00164","citing_paper":"/paper/2502.00379"},"observation_digest":"sha256:98dda2eb8126dbba4e28a0bb5026cd74aedb2f0909234e2a9e097f343e8a3dda","observation_id":"10b37c0d-a971-40b9-8b03-9bf9f95d6b43","resolution":{"observed_at":"2026-08-09T19:18:44.976732Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T19:18:46.133844Z","title":"Minerl diamond 2021 competition: Overview, results, and lessons learned","venue":null,"work_id":"196c7b72-bbdf-4cd2-a084-003e91e0b970","year":2021},"citing_paper":{"arxiv_id":"2502.00379","last_updated":"2025-06-12T16:28:52Z","snapshot_observed_at":"2026-08-10T10:34:42.717916Z","submitted_at":"2025-02-01T09:35:51Z","title":"Latent Action Learning Requires Supervision in the Presence of Distractors","version":5},"reference_index":30,"source":"arxiv_source","source_observed_at":"2026-08-09T19:18:44.982135Z"},"links":{"citing_paper":"/paper/2502.00379"},"observation_digest":"sha256:9aa020172ad36dc38f58c33b401b251abafea23db68616241ffee418da1ca433","observation_id":"dd18457a-dde0-4282-9186-7c70183bcfb5","resolution":{"observed_at":"2026-08-09T19:18:46.139491Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2403.12945","last_updated":"2025-04-22T17:57:51Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-03-19T17:48:38Z","title":"DROID: A Large-Scale In-The-Wild Robot Manipulation Dataset","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2403.12945","snapshot_observed_at":"2026-08-09T19:18:44.987061Z","title":"K., Chen, L","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2502.00379","last_updated":"2025-06-12T16:28:52Z","snapshot_observed_at":"2026-08-10T10:34:42.717916Z","submitted_at":"2025-02-01T09:35:51Z","title":"Latent Action Learning Requires Supervision in the Presence of Distractors","version":5},"reference_index":31,"source":"arxiv_source","source_observed_at":"2026-08-09T19:18:44.987061Z"},"links":{"cited_paper":"/paper/2403.12945","citing_paper":"/paper/2502.00379"},"observation_digest":"sha256:51c461d956ae477a20a2ee7d4cd6b8c585ca1faedafde414e4198c0bb3891ea4","observation_id":"f518c15d-5e35-4c9f-93c6-27d32c09e562","resolution":{"observed_at":"2026-08-09T19:18:44.987061Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2406.06037","last_updated":"2024-06-10T06:06:38Z","snapshot_observed_at":"2026-07-06T18:27:58.433967Z","submitted_at":"2024-06-10T06:06:38Z","title":"Investigating Pre-Training Objectives for Generalization in Vision-Based Reinforcement Learning","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2406.06037","snapshot_observed_at":"2026-08-09T19:18:44.992363Z","title":"Investigating pre-training objectives for generalization in vision-based reinforcement learning","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2502.00379","last_updated":"2025-06-12T16:28:52Z","snapshot_observed_at":"2026-08-10T10:34:42.717916Z","submitted_at":"2025-02-01T09:35:51Z","title":"Latent Action Learning Requires Supervision in the Presence of Distractors","version":5},"reference_index":32,"source":"arxiv_source","source_observed_at":"2026-08-09T19:18:44.992363Z"},"links":{"cited_paper":"/paper/2406.06037","citing_paper":"/paper/2502.00379"},"observation_digest":"sha256:1f38a4ee5e9adb388b32f7b9dc7c291a414be3eb39d242157fdfec024b012c59","observation_id":"a6f36c55-42b5-4abd-be9a-324f4aa522d0","resolution":{"observed_at":"2026-08-09T19:18:44.992363Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2406.09246","last_updated":"2024-09-05T19:46:34Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-06-13T15:46:55Z","title":"OpenVLA: An Open-Source Vision-Language-Action Model","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2406.09246","snapshot_observed_at":"2026-08-09T19:18:44.997482Z","title":"J., Pertsch, K., Karamcheti, S., Xiao, T., Balakrishna, A., Nair, S., Rafailov, R., Foster, E., Lam, G., Sanketi, P., et al","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2502.00379","last_updated":"2025-06-12T16:28:52Z","snapshot_observed_at":"2026-08-10T10:34:42.717916Z","submitted_at":"2025-02-01T09:35:51Z","title":"Latent Action Learning Requires Supervision in the Presence of Distractors","version":5},"reference_index":33,"source":"arxiv_source","source_observed_at":"2026-08-09T19:18:44.997482Z"},"links":{"cited_paper":"/paper/2406.09246","citing_paper":"/paper/2502.00379"},"observation_digest":"sha256:a383e95f1a42d21bb567176fcd3f57009447c1d4378daa7ddfd8f67b38ca50aa","observation_id":"b2506441-4e21-492a-8a0a-cd91791b0ad9","resolution":{"observed_at":"2026-08-09T19:18:44.997482Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2207.08229","last_updated":"2022-12-27T22:24:38Z","snapshot_observed_at":"2026-08-09T06:35:09.788305Z","submitted_at":"2022-07-17T17:06:52Z","title":"Guaranteed Discovery of Control-Endogenous Latent States with Multi-Step Inverse Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2207.08229","snapshot_observed_at":"2026-08-09T19:18:45.003425Z","title":"Guaranteed discovery of control-endogenous latent states with multi-step inverse models","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2502.00379","last_updated":"2025-06-12T16:28:52Z","snapshot_observed_at":"2026-08-10T10:34:42.717916Z","submitted_at":"2025-02-01T09:35:51Z","title":"Latent Action Learning Requires Supervision in the Presence of Distractors","version":5},"reference_index":34,"source":"arxiv_source","source_observed_at":"2026-08-09T19:18:45.003425Z"},"links":{"cited_paper":"/paper/2207.08229","citing_paper":"/paper/2502.00379"},"observation_digest":"sha256:df382c4cec5fa6bc5cc707d4317dfee806bd47bbe336a08bf7cef9a4bfeb93e2","observation_id":"df774c13-2057-40a3-a735-e01523951dbb","resolution":{"observed_at":"2026-08-09T19:18:45.003425Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2403.11940","last_updated":"2024-09-06T21:58:59Z","snapshot_observed_at":"2026-08-10T12:12:07.890976Z","submitted_at":"2024-03-18T16:36:01Z","title":"Multistep Inverse Is Not All You Need","version":2},"cited_work":{"arxiv_id":"2403.11940","doi":null,"metadata_source":"pith","pith_arxiv_id":"2403.11940","snapshot_observed_at":"2026-08-09T19:18:45.609550Z","title":"Multistep Inverse Is Not All You Need","venue":"cs.LG","work_id":"4f048379-da83-4383-b2cf-0a1fe0d131d4","year":2024},"citing_paper":{"arxiv_id":"2502.00379","last_updated":"2025-06-12T16:28:52Z","snapshot_observed_at":"2026-08-10T10:34:42.717916Z","submitted_at":"2025-02-01T09:35:51Z","title":"Latent Action Learning Requires Supervision in the Presence of Distractors","version":5},"reference_index":35,"source":"arxiv_source","source_observed_at":"2026-08-09T19:18:45.009287Z"},"links":{"cited_paper":"/paper/2403.11940","citing_paper":"/paper/2502.00379"},"observation_digest":"sha256:4be880bbfc590c976669a844419b2100662b0ce2dcfa08f01089c165cd389d23","observation_id":"a26793a2-6601-4d57-adff-9ad01ffe263f","resolution":{"observed_at":"2026-08-09T19:18:45.615088Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2005.01643","last_updated":"2020-11-01T23:50:25Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2020-05-04T17:00:15Z","title":"Offline Reinforcement Learning: Tutorial, Review, and Perspectives on Open Problems","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2005.01643","snapshot_observed_at":"2026-08-09T19:18:45.014925Z","title":"Offline reinforcement learning: Tutorial, review, and perspectives on open problems","venue":null,"work_id":null,"year":2005},"citing_paper":{"arxiv_id":"2502.00379","last_updated":"2025-06-12T16:28:52Z","snapshot_observed_at":"2026-08-10T10:34:42.717916Z","submitted_at":"2025-02-01T09:35:51Z","title":"Latent Action Learning Requires Supervision in the Presence of Distractors","version":5},"reference_index":36,"source":"arxiv_source","source_observed_at":"2026-08-09T19:18:45.014925Z"},"links":{"cited_paper":"/paper/2005.01643","citing_paper":"/paper/2502.00379"},"observation_digest":"sha256:915dead5e3e1097c4a81f2005bc41bb90118e5878f6ba27f267a8f6d60dbbfe8","observation_id":"5a3dca58-a7cb-4496-bc9e-6b16b6fc21d0","resolution":{"observed_at":"2026-08-09T19:18:45.014925Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T19:18:46.117506Z","title":"Robust representation learning by clustering with bisimulation metrics for visual reinforcement learning with distractions","venue":null,"work_id":"34b541ef-1d7f-402b-a40c-aa6d44d63b35","year":2023},"citing_paper":{"arxiv_id":"2502.00379","last_updated":"2025-06-12T16:28:52Z","snapshot_observed_at":"2026-08-10T10:34:42.717916Z","submitted_at":"2025-02-01T09:35:51Z","title":"Latent Action Learning Requires Supervision in the Presence of Distractors","version":5},"reference_index":37,"source":"arxiv_source","source_observed_at":"2026-08-09T19:18:45.020263Z"},"links":{"citing_paper":"/paper/2502.00379"},"observation_digest":"sha256:98a8bb3f8810899e8f485075b237a199158ce40961476a20a1d8aac98a541d57","observation_id":"b97612f2-3c08-4a8a-9168-98b9af424fdb","resolution":{"observed_at":"2026-08-09T19:18:46.122744Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T19:18:46.101426Z","title":"Learning world models with identifiable factorization","venue":null,"work_id":"8ec5f1fd-e299-401e-a2cd-d261846bf933","year":2023},"citing_paper":{"arxiv_id":"2502.00379","last_updated":"2025-06-12T16:28:52Z","snapshot_observed_at":"2026-08-10T10:34:42.717916Z","submitted_at":"2025-02-01T09:35:51Z","title":"Latent Action Learning Requires Supervision in the Presence of Distractors","version":5},"reference_index":38,"source":"arxiv_source","source_observed_at":"2026-08-09T19:18:45.025435Z"},"links":{"citing_paper":"/paper/2502.00379"},"observation_digest":"sha256:0e161096aee9cc68cda2c3655a582de940ca400c845930ac37fb0868588fb3bd","observation_id":"f00c1679-5fea-4d8b-9187-f76fc7b1ee8b","resolution":{"observed_at":"2026-08-09T19:18:46.106666Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2210.04561","last_updated":"2024-10-21T14:11:42Z","snapshot_observed_at":"2026-08-10T09:08:51.877870Z","submitted_at":"2022-10-10T11:01:57Z","title":"A Comprehensive Survey of Data Augmentation in Visual Reinforcement Learning","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2210.04561","snapshot_observed_at":"2026-08-09T19:18:45.030415Z","title":"A comprehensive survey of data augmentation in visual reinforcement learning","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2502.00379","last_updated":"2025-06-12T16:28:52Z","snapshot_observed_at":"2026-08-10T10:34:42.717916Z","submitted_at":"2025-02-01T09:35:51Z","title":"Latent Action Learning Requires Supervision in the Presence of Distractors","version":5},"reference_index":39,"source":"arxiv_source","source_observed_at":"2026-08-09T19:18:45.030415Z"},"links":{"cited_paper":"/paper/2210.04561","citing_paper":"/paper/2502.00379"},"observation_digest":"sha256:c33282a0277e985890755ae3841a629b9d7fa0eb70e6e7e57870fabe6de48425","observation_id":"d9ecccd5-be49-4958-a438-f42c4c0fc920","resolution":{"observed_at":"2026-08-09T19:18:45.030415Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2404.19664","last_updated":"2025-07-23T17:31:03Z","snapshot_observed_at":"2026-08-02T13:46:05.910140Z","submitted_at":"2024-04-30T15:57:41Z","title":"Towards Generalist Robot Learning from Internet Video: A Survey","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2404.19664","snapshot_observed_at":"2026-08-09T19:18:45.035649Z","title":"C., Schmidt, D., Acero, F., Herr, N., Du, Y., Thuruthel, T","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2502.00379","last_updated":"2025-06-12T16:28:52Z","snapshot_observed_at":"2026-08-10T10:34:42.717916Z","submitted_at":"2025-02-01T09:35:51Z","title":"Latent Action Learning Requires Supervision in the Presence of Distractors","version":5},"reference_index":40,"source":"arxiv_source","source_observed_at":"2026-08-09T19:18:45.035649Z"},"links":{"cited_paper":"/paper/2404.19664","citing_paper":"/paper/2502.00379"},"observation_digest":"sha256:d6db7fc5adc1481a0ab9d3cfadbf50f3b6749c344e849d2cb9006096e60cc0b2","observation_id":"d9d84fe3-0d10-4903-86cd-413ea9c08a0f","resolution":{"observed_at":"2026-08-09T19:18:45.035649Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2309.15505","last_updated":"2023-10-12T07:55:05Z","snapshot_observed_at":"2026-07-06T16:24:17.829828Z","submitted_at":"2023-09-27T09:13:40Z","title":"Finite Scalar Quantization: VQ-VAE Made Simple","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2309.15505","snapshot_observed_at":"2026-08-09T19:18:45.041721Z","title":"Finite scalar quantization: Vq-vae made simple","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2502.00379","last_updated":"2025-06-12T16:28:52Z","snapshot_observed_at":"2026-08-10T10:34:42.717916Z","submitted_at":"2025-02-01T09:35:51Z","title":"Latent Action Learning Requires Supervision in the Presence of Distractors","version":5},"reference_index":41,"source":"arxiv_source","source_observed_at":"2026-08-09T19:18:45.041721Z"},"links":{"cited_paper":"/paper/2309.15505","citing_paper":"/paper/2502.00379"},"observation_digest":"sha256:770d1fe5790614e829301f907ecd262ae994ca83dbd6175b4a70d7b2a6afa4ea","observation_id":"a26de0d2-cbf5-4d28-a9d7-41652c8db07f","resolution":{"observed_at":"2026-08-09T19:18:45.041721Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2403.13765","last_updated":"2024-03-20T17:28:17Z","snapshot_observed_at":"2026-08-01T20:23:16.143117Z","submitted_at":"2024-03-20T17:28:17Z","title":"Towards Principled Representation Learning from Videos for Reinforcement Learning","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2403.13765","snapshot_observed_at":"2026-08-09T19:18:45.047550Z","title":"Towards principled representation learning from videos for reinforcement learning","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2502.00379","last_updated":"2025-06-12T16:28:52Z","snapshot_observed_at":"2026-08-10T10:34:42.717916Z","submitted_at":"2025-02-01T09:35:51Z","title":"Latent Action Learning Requires Supervision in the Presence of Distractors","version":5},"reference_index":42,"source":"arxiv_source","source_observed_at":"2026-08-09T19:18:45.047550Z"},"links":{"cited_paper":"/paper/2403.13765","citing_paper":"/paper/2502.00379"},"observation_digest":"sha256:38c68ac83692df202a9c253a7ee76b56a26e29b2516c2286930c76ec89f99b63","observation_id":"9dc12d7d-ba2c-4b01-9278-8003c1341e15","resolution":{"observed_at":"2026-08-09T19:18:45.047550Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2401.08898","last_updated":"2024-04-21T05:59:37Z","snapshot_observed_at":"2026-08-07T07:35:05.900443Z","submitted_at":"2024-01-17T00:47:43Z","title":"Bridging State and History Representations: Understanding Self-Predictive RL","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2401.08898","snapshot_observed_at":"2026-08-09T19:18:45.052790Z","title":"Bridging state and history representations: Understanding self-predictive rl","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2502.00379","last_updated":"2025-06-12T16:28:52Z","snapshot_observed_at":"2026-08-10T10:34:42.717916Z","submitted_at":"2025-02-01T09:35:51Z","title":"Latent Action Learning Requires Supervision in the Presence of Distractors","version":5},"reference_index":43,"source":"arxiv_source","source_observed_at":"2026-08-09T19:18:45.052790Z"},"links":{"cited_paper":"/paper/2401.08898","citing_paper":"/paper/2502.00379"},"observation_digest":"sha256:7615a0c0b22be8709624c2bdcdea1b4a91b8d38bd86b47cd5f9f02cdf3c2038b","observation_id":"772587d5-f837-45c5-b9a6-a8171c8d85e6","resolution":{"observed_at":"2026-08-09T19:18:45.052790Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T19:18:46.085226Z","title":"and Taniguchi, T","venue":null,"work_id":"155c1056-f00c-4417-b2f8-cbe9a181d16a","year":2021},"citing_paper":{"arxiv_id":"2502.00379","last_updated":"2025-06-12T16:28:52Z","snapshot_observed_at":"2026-08-10T10:34:42.717916Z","submitted_at":"2025-02-01T09:35:51Z","title":"Latent Action Learning Requires Supervision in the Presence of Distractors","version":5},"reference_index":44,"source":"arxiv_source","source_observed_at":"2026-08-09T19:18:45.058143Z"},"links":{"citing_paper":"/paper/2502.00379"},"observation_digest":"sha256:15c6971510577d15ead920cd9738a796b47b57384129f9186060079bf9b8fcf8","observation_id":"350e4a5c-3ec2-4dac-b51c-d378c551f0a4","resolution":{"observed_at":"2026-08-09T19:18:46.090335Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2409.18330","last_updated":"2024-09-26T23:07:01Z","snapshot_observed_at":"2026-07-06T19:23:06.818254Z","submitted_at":"2024-09-26T23:07:01Z","title":"DMC-VB: A Benchmark for Representation Learning for Control with Visual Distractors","version":1},"cited_work":{"arxiv_id":"2409.18330","doi":null,"metadata_source":"pith","pith_arxiv_id":"2409.18330","snapshot_observed_at":"2026-08-09T19:18:45.486801Z","title":"DMC-VB: A Benchmark for Representation Learning for Control with Visual Distractors","venue":"cs.LG","work_id":"d022611a-b551-430f-8ff1-fc788b5891c0","year":2024},"citing_paper":{"arxiv_id":"2502.00379","last_updated":"2025-06-12T16:28:52Z","snapshot_observed_at":"2026-08-10T10:34:42.717916Z","submitted_at":"2025-02-01T09:35:51Z","title":"Latent Action Learning Requires Supervision in the Presence of Distractors","version":5},"reference_index":45,"source":"arxiv_source","source_observed_at":"2026-08-09T19:18:45.063070Z"},"links":{"cited_paper":"/paper/2409.18330","citing_paper":"/paper/2502.00379"},"observation_digest":"sha256:f6d37b46322dfd0eafee240ebf8bc994ff32808f3c14a538855fed842f5f4aa0","observation_id":"51bc5c35-a169-4383-82d2-ab3e9fd4c905","resolution":{"observed_at":"2026-08-09T19:18:45.492478Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T19:18:45.067876Z","title":"Stable-baselines3: Reliable reinforcement learning implementations","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2502.00379","last_updated":"2025-06-12T16:28:52Z","snapshot_observed_at":"2026-08-10T10:34:42.717916Z","submitted_at":"2025-02-01T09:35:51Z","title":"Latent Action Learning Requires Supervision in the Presence of Distractors","version":5},"reference_index":46,"source":"arxiv_source","source_observed_at":"2026-08-09T19:18:45.067876Z"},"links":{"citing_paper":"/paper/2502.00379"},"observation_digest":"sha256:790406d2a3bfe218147d847012faf5b740c59bca3c4284176051fd20192c30ab","observation_id":"13e17c22-7cca-4758-b66e-8f45f768f52c","resolution":{"observed_at":"2026-08-09T19:18:45.067876Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2406.02696","last_updated":"2024-06-04T18:15:44Z","snapshot_observed_at":"2026-08-10T09:01:40.974323Z","submitted_at":"2024-06-04T18:15:44Z","title":"iQRL -- Implicitly Quantized Representations for Sample-efficient Reinforcement Learning","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2406.02696","snapshot_observed_at":"2026-08-09T19:18:45.072273Z","title":"iqrl--implicitly quantized representations for sample-efficient reinforcement learning","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2502.00379","last_updated":"2025-06-12T16:28:52Z","snapshot_observed_at":"2026-08-10T10:34:42.717916Z","submitted_at":"2025-02-01T09:35:51Z","title":"Latent Action Learning Requires Supervision in the Presence of Distractors","version":5},"reference_index":47,"source":"arxiv_source","source_observed_at":"2026-08-09T19:18:45.072273Z"},"links":{"cited_paper":"/paper/2406.02696","citing_paper":"/paper/2502.00379"},"observation_digest":"sha256:809fa66ba2ab214257635ae96e20867e9c223a516e22e33b764de4616a4b8dd8","observation_id":"22895b52-5e1e-4286-9940-b63b4177c63a","resolution":{"observed_at":"2026-08-09T19:18:45.072273Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2011.06507","last_updated":"2021-11-04T20:07:57Z","snapshot_observed_at":"2026-07-06T10:14:07.125865Z","submitted_at":"2020-11-12T17:15:48Z","title":"Reinforcement Learning with Videos: Combining Offline Observations with Interaction","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2011.06507","snapshot_observed_at":"2026-08-09T19:18:45.077358Z","title":"Reinforcement learning with videos: Combining offline observations with interaction","venue":null,"work_id":null,"year":2011},"citing_paper":{"arxiv_id":"2502.00379","last_updated":"2025-06-12T16:28:52Z","snapshot_observed_at":"2026-08-10T10:34:42.717916Z","submitted_at":"2025-02-01T09:35:51Z","title":"Latent Action Learning Requires Supervision in the Presence of Distractors","version":5},"reference_index":48,"source":"arxiv_source","source_observed_at":"2026-08-09T19:18:45.077358Z"},"links":{"cited_paper":"/paper/2011.06507","citing_paper":"/paper/2502.00379"},"observation_digest":"sha256:65aae0136324f6bc4dc30550b5f52da644f1f318533241b5db566e2f8ab52b00","observation_id":"a0bb9b71-31c6-45bd-a161-aeeabd9824fa","resolution":{"observed_at":"2026-08-09T19:18:45.077358Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2312.10812","last_updated":"2024-03-27T00:15:16Z","snapshot_observed_at":"2026-08-09T23:26:17.852639Z","submitted_at":"2023-12-17T20:39:54Z","title":"Learning to Act without Actions","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2312.10812","snapshot_observed_at":"2026-08-09T19:18:45.082822Z","title":"and Jiang, M","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2502.00379","last_updated":"2025-06-12T16:28:52Z","snapshot_observed_at":"2026-08-10T10:34:42.717916Z","submitted_at":"2025-02-01T09:35:51Z","title":"Latent Action Learning Requires Supervision in the Presence of Distractors","version":5},"reference_index":49,"source":"arxiv_source","source_observed_at":"2026-08-09T19:18:45.082822Z"},"links":{"cited_paper":"/paper/2312.10812","citing_paper":"/paper/2502.00379"},"observation_digest":"sha256:90d86078fbd9dd26d735bda2ea8c058659b6bf96cbc35ed8e81c5a9049989a7a","observation_id":"f7fd979d-155e-4f7b-9645-dee15c932b07","resolution":{"observed_at":"2026-08-09T19:18:45.082822Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1707.06347","last_updated":"2017-08-28T09:20:06Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2017-07-20T02:32:33Z","title":"Proximal Policy Optimization Algorithms","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1707.06347","snapshot_observed_at":"2026-08-09T19:18:45.088262Z","title":"Proximal policy optimization algorithms","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2502.00379","last_updated":"2025-06-12T16:28:52Z","snapshot_observed_at":"2026-08-10T10:34:42.717916Z","submitted_at":"2025-02-01T09:35:51Z","title":"Latent Action Learning Requires Supervision in the Presence of Distractors","version":5},"reference_index":50,"source":"arxiv_source","source_observed_at":"2026-08-09T19:18:45.088262Z"},"links":{"cited_paper":"/paper/1707.06347","citing_paper":"/paper/2502.00379"},"observation_digest":"sha256:69cba64c1a0efd0c07fcdc935f0f4930c7479e24b88c26be5ec22c6745c8568d","observation_id":"7969b19d-e70d-4599-b4c0-0c0586f6e0d1","resolution":{"observed_at":"2026-08-09T19:18:45.088262Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2007.05929","last_updated":"2021-05-20T09:15:57Z","snapshot_observed_at":"2026-08-10T04:32:16.941126Z","submitted_at":"2020-07-12T07:38:15Z","title":"Data-Efficient Reinforcement Learning with Self-Predictive Representations","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2007.05929","snapshot_observed_at":"2026-08-09T19:18:45.093521Z","title":"D., Courville, A., and Bachman, P","venue":null,"work_id":null,"year":2007},"citing_paper":{"arxiv_id":"2502.00379","last_updated":"2025-06-12T16:28:52Z","snapshot_observed_at":"2026-08-10T10:34:42.717916Z","submitted_at":"2025-02-01T09:35:51Z","title":"Latent Action Learning Requires Supervision in the Presence of Distractors","version":5},"reference_index":51,"source":"arxiv_source","source_observed_at":"2026-08-09T19:18:45.093521Z"},"links":{"cited_paper":"/paper/2007.05929","citing_paper":"/paper/2502.00379"},"observation_digest":"sha256:833aca066c6dbfe886a048c7c41508dc528359bc3fed12eb0fe2ce4ebad2b176","observation_id":"b64c9e3c-9d54-4576-aa5f-63536dc43a18","resolution":{"observed_at":"2026-08-09T19:18:45.093521Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T19:18:46.056940Z","title":"The pitfalls of simplicity bias in neural networks","venue":null,"work_id":"0a2bb6ad-248e-4017-b0fb-01683b5734aa","year":2020},"citing_paper":{"arxiv_id":"2502.00379","last_updated":"2025-06-12T16:28:52Z","snapshot_observed_at":"2026-08-10T10:34:42.717916Z","submitted_at":"2025-02-01T09:35:51Z","title":"Latent Action Learning Requires Supervision in the Presence of Distractors","version":5},"reference_index":52,"source":"arxiv_source","source_observed_at":"2026-08-09T19:18:45.098885Z"},"links":{"citing_paper":"/paper/2502.00379"},"observation_digest":"sha256:4d83340679b870d5ce3238dcc634b82171ef35d09b82def34bb0a40b415e94b3","observation_id":"dcc1f2fc-6c5d-49c8-8764-f4f0ea64161c","resolution":{"observed_at":"2026-08-09T19:18:46.062595Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2101.02722","last_updated":"2021-01-07T19:03:34Z","snapshot_observed_at":"2026-08-06T20:03:52.435962Z","submitted_at":"2021-01-07T19:03:34Z","title":"The Distracting Control Suite -- A Challenging Benchmark for Reinforcement Learning from Pixels","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2101.02722","snapshot_observed_at":"2026-08-09T19:18:45.104131Z","title":"The distracting control suite--a challenging benchmark for reinforcement learning from pixels","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2502.00379","last_updated":"2025-06-12T16:28:52Z","snapshot_observed_at":"2026-08-10T10:34:42.717916Z","submitted_at":"2025-02-01T09:35:51Z","title":"Latent Action Learning Requires Supervision in the Presence of Distractors","version":5},"reference_index":53,"source":"arxiv_source","source_observed_at":"2026-08-09T19:18:45.104131Z"},"links":{"cited_paper":"/paper/2101.02722","citing_paper":"/paper/2502.00379"},"observation_digest":"sha256:3b9302c3c07a749afc9a5787df7a09d820e2d6bd25c60eb0c245d260d2460444","observation_id":"f133ecba-94d7-4555-9d6a-8e387930f738","resolution":{"observed_at":"2026-08-09T19:18:45.104131Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T19:18:46.040591Z","title":"and Kyrki, V","venue":null,"work_id":"0234df6f-73d6-4721-a7bc-5c6c7769bdf6","year":2023},"citing_paper":{"arxiv_id":"2502.00379","last_updated":"2025-06-12T16:28:52Z","snapshot_observed_at":"2026-08-10T10:34:42.717916Z","submitted_at":"2025-02-01T09:35:51Z","title":"Latent Action Learning Requires Supervision in the Presence of Distractors","version":5},"reference_index":54,"source":"arxiv_source","source_observed_at":"2026-08-09T19:18:45.109739Z"},"links":{"citing_paper":"/paper/2502.00379"},"observation_digest":"sha256:4a2659777cd854562243eb938240e39e6c6c3f3a4d867f5c3d4f77958fbae22f","observation_id":"b1fdce95-7101-442e-8065-e5f68e41cc9f","resolution":{"observed_at":"2026-08-09T19:18:46.045786Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2111.07775","last_updated":"2021-11-15T14:16:28Z","snapshot_observed_at":"2026-07-06T12:08:35.761426Z","submitted_at":"2021-11-15T14:16:28Z","title":"Learning Representations for Pixel-based Control: What Matters and Why?","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2111.07775","snapshot_observed_at":"2026-08-09T19:18:45.115095Z","title":"A., Zhang, A., and Taylor, M","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2502.00379","last_updated":"2025-06-12T16:28:52Z","snapshot_observed_at":"2026-08-10T10:34:42.717916Z","submitted_at":"2025-02-01T09:35:51Z","title":"Latent Action Learning Requires Supervision in the Presence of Distractors","version":5},"reference_index":55,"source":"arxiv_source","source_observed_at":"2026-08-09T19:18:45.115095Z"},"links":{"cited_paper":"/paper/2111.07775","citing_paper":"/paper/2502.00379"},"observation_digest":"sha256:c7c784cbd8994c9fc8f1ddaadc38e5c6f71cdbea30305e4b08bac28c3f86057d","observation_id":"b154cbca-4097-4d94-b874-d683cbfa50a4","resolution":{"observed_at":"2026-08-09T19:18:45.115095Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1805.01954","last_updated":"2018-05-11T21:48:52Z","snapshot_observed_at":"2026-08-06T03:56:45.024415Z","submitted_at":"2018-05-04T22:36:58Z","title":"Behavioral Cloning from Observation","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1805.01954","snapshot_observed_at":"2026-08-09T19:18:45.120377Z","title":"Behavioral cloning from observation","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2502.00379","last_updated":"2025-06-12T16:28:52Z","snapshot_observed_at":"2026-08-10T10:34:42.717916Z","submitted_at":"2025-02-01T09:35:51Z","title":"Latent Action Learning Requires Supervision in the Presence of Distractors","version":5},"reference_index":56,"source":"arxiv_source","source_observed_at":"2026-08-09T19:18:45.120377Z"},"links":{"cited_paper":"/paper/1805.01954","citing_paper":"/paper/2502.00379"},"observation_digest":"sha256:e22aa2ec4bf0a4d363c07ee4be6e50ef12c595290107147f0675e01182dee811","observation_id":"d0b96b97-3338-4e95-a025-0e3dd882ac57","resolution":{"observed_at":"2026-08-09T19:18:45.120377Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1905.13566","last_updated":"2019-06-19T03:55:09Z","snapshot_observed_at":"2026-07-06T07:57:02.232660Z","submitted_at":"2019-05-30T05:54:30Z","title":"Recent Advances in Imitation Learning from Observation","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1905.13566","snapshot_observed_at":"2026-08-09T19:18:45.125629Z","title":"Recent advances in imitation learning from observation","venue":null,"work_id":null,"year":1905},"citing_paper":{"arxiv_id":"2502.00379","last_updated":"2025-06-12T16:28:52Z","snapshot_observed_at":"2026-08-10T10:34:42.717916Z","submitted_at":"2025-02-01T09:35:51Z","title":"Latent Action Learning Requires Supervision in the Presence of Distractors","version":5},"reference_index":57,"source":"arxiv_source","source_observed_at":"2026-08-09T19:18:45.125629Z"},"links":{"cited_paper":"/paper/1905.13566","citing_paper":"/paper/2502.00379"},"observation_digest":"sha256:b1b3f85cbb47df18e51708974fbef081f21d6b3b98f09a1050704b2b830efa51","observation_id":"91cc1289-e7e5-4bed-8e0a-69dca263cf65","resolution":{"observed_at":"2026-08-09T19:18:45.125629Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T19:18:45.131440Z","title":"Neural discrete representation learning","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2502.00379","last_updated":"2025-06-12T16:28:52Z","snapshot_observed_at":"2026-08-10T10:34:42.717916Z","submitted_at":"2025-02-01T09:35:51Z","title":"Latent Action Learning Requires Supervision in the Presence of Distractors","version":5},"reference_index":58,"source":"arxiv_source","source_observed_at":"2026-08-09T19:18:45.131440Z"},"links":{"citing_paper":"/paper/2502.00379"},"observation_digest":"sha256:5931e080f35f52b91b1c2a1b33003d14dac8d68a02ae5e65b6f28d1a48164956","observation_id":"90a847eb-cd73-4f1a-a713-2813f349b653","resolution":{"observed_at":"2026-08-09T19:18:45.131440Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T19:18:45.136590Z","title":"Attention is all you need","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2502.00379","last_updated":"2025-06-12T16:28:52Z","snapshot_observed_at":"2026-08-10T10:34:42.717916Z","submitted_at":"2025-02-01T09:35:51Z","title":"Latent Action Learning Requires Supervision in the Presence of Distractors","version":5},"reference_index":59,"source":"arxiv_source","source_observed_at":"2026-08-09T19:18:45.136590Z"},"links":{"citing_paper":"/paper/2502.00379"},"observation_digest":"sha256:6bd6cfb216f1f6f7e11342ac543deec994db11d013aa2ff44311a8531ff070d7","observation_id":"9f174e0e-c3a6-47a4-9c4a-b3996073a2c3","resolution":{"observed_at":"2026-08-09T19:18:45.136590Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T19:18:45.141670Z","title":"Semail: eliminating distractors in visual imitation via separated models","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2502.00379","last_updated":"2025-06-12T16:28:52Z","snapshot_observed_at":"2026-08-10T10:34:42.717916Z","submitted_at":"2025-02-01T09:35:51Z","title":"Latent Action Learning Requires Supervision in the Presence of Distractors","version":5},"reference_index":60,"source":"arxiv_source","source_observed_at":"2026-08-09T19:18:45.141670Z"},"links":{"citing_paper":"/paper/2502.00379"},"observation_digest":"sha256:4ca680fc9a532e300c15145f5ec20cb2d2cb90e614a47324c410e65b0883b5ee","observation_id":"d254dc04-e8cf-41c5-ae70-254d93485071","resolution":{"observed_at":"2026-08-09T19:18:45.141670Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2206.15477","last_updated":"2023-04-06T23:56:38Z","snapshot_observed_at":"2026-08-04T10:56:32.760733Z","submitted_at":"2022-06-30T17:59:49Z","title":"Denoised MDPs: Learning World Models Better Than the World Itself","version":6},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2206.15477","snapshot_observed_at":"2026-08-09T19:18:45.146809Z","title":"S., Torralba, A., Isola, P., Zhang, A., and Tian, Y","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2502.00379","last_updated":"2025-06-12T16:28:52Z","snapshot_observed_at":"2026-08-10T10:34:42.717916Z","submitted_at":"2025-02-01T09:35:51Z","title":"Latent Action Learning Requires Supervision in the Presence of Distractors","version":5},"reference_index":61,"source":"arxiv_source","source_observed_at":"2026-08-09T19:18:45.146809Z"},"links":{"cited_paper":"/paper/2206.15477","citing_paper":"/paper/2502.00379"},"observation_digest":"sha256:be43ca70a5c27b7af110d679a8150dd88b7d974d9ef7506b69eaba77f4aa2052","observation_id":"787afeb1-f994-4e6c-8c5c-19f034ad1dc4","resolution":{"observed_at":"2026-08-09T19:18:45.146809Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2403.09976","last_updated":"2024-06-05T12:25:53Z","snapshot_observed_at":"2026-08-02T13:54:18.599068Z","submitted_at":"2024-03-15T02:46:19Z","title":"AD3: Implicit Action is the Key for World Models to Distinguish the Diverse Visual Distractors","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2403.09976","snapshot_observed_at":"2026-08-09T19:18:45.151867Z","title":"Ad3: Implicit action is the key for world models to distinguish the diverse visual distractors","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2502.00379","last_updated":"2025-06-12T16:28:52Z","snapshot_observed_at":"2026-08-10T10:34:42.717916Z","submitted_at":"2025-02-01T09:35:51Z","title":"Latent Action Learning Requires Supervision in the Presence of Distractors","version":5},"reference_index":62,"source":"arxiv_source","source_observed_at":"2026-08-09T19:18:45.151867Z"},"links":{"cited_paper":"/paper/2403.09976","citing_paper":"/paper/2502.00379"},"observation_digest":"sha256:43069c59252ea594fa305e9ea75ad98740f9d58bb4d4523f6e398501b1e6e77a","observation_id":"285fb2da-fcb5-4266-986c-945535bae79c","resolution":{"observed_at":"2026-08-09T19:18:45.151867Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2204.11827","last_updated":"2022-04-25T17:57:10Z","snapshot_observed_at":"2026-08-04T06:24:13.748675Z","submitted_at":"2022-04-25T17:57:10Z","title":"Task-Induced Representation Learning","version":1},"cited_work":{"arxiv_id":"2204.11827","doi":null,"metadata_source":"pith","pith_arxiv_id":"2204.11827","snapshot_observed_at":"2026-08-09T19:18:45.285977Z","title":"Task-Induced Representation Learning","venue":"cs.LG","work_id":"8fe9712b-280f-40da-b16a-4e8eb67e70b4","year":2022},"citing_paper":{"arxiv_id":"2502.00379","last_updated":"2025-06-12T16:28:52Z","snapshot_observed_at":"2026-08-10T10:34:42.717916Z","submitted_at":"2025-02-01T09:35:51Z","title":"Latent Action Learning Requires Supervision in the Presence of Distractors","version":5},"reference_index":63,"source":"arxiv_source","source_observed_at":"2026-08-09T19:18:45.156974Z"},"links":{"cited_paper":"/paper/2204.11827","citing_paper":"/paper/2502.00379"},"observation_digest":"sha256:fb40f3bba143e75ef64aad0390451c8b1ee5feaae27f22b51de48bef4c264f58","observation_id":"42af9bc0-a71a-4153-87cd-1874d94c7bbf","resolution":{"observed_at":"2026-08-09T19:18:45.293115Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2410.11758","last_updated":"2025-05-15T12:13:37Z","snapshot_observed_at":"2026-07-06T19:33:57.090585Z","submitted_at":"2024-10-15T16:28:09Z","title":"Latent Action Pretraining from Videos","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2410.11758","snapshot_observed_at":"2026-08-09T19:18:45.162683Z","title":"Y., et al","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2502.00379","last_updated":"2025-06-12T16:28:52Z","snapshot_observed_at":"2026-08-10T10:34:42.717916Z","submitted_at":"2025-02-01T09:35:51Z","title":"Latent Action Learning Requires Supervision in the Presence of Distractors","version":5},"reference_index":64,"source":"arxiv_source","source_observed_at":"2026-08-09T19:18:45.162683Z"},"links":{"cited_paper":"/paper/2410.11758","citing_paper":"/paper/2502.00379"},"observation_digest":"sha256:9ffc4544823a9d3bb9612329e6e80f15a11beeb23da4723f37aafb6b9fad87f4","observation_id":"949c983c-e7c4-406d-8f3a-9aab9cb7a334","resolution":{"observed_at":"2026-08-09T19:18:45.162683Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2006.10742","last_updated":"2021-04-07T01:57:14Z","snapshot_observed_at":"2026-07-06T09:30:32.320227Z","submitted_at":"2020-06-18T17:59:35Z","title":"Learning Invariant Representations for Reinforcement Learning without Reconstruction","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2006.10742","snapshot_observed_at":"2026-08-09T19:18:45.167910Z","title":"Learning invariant representations for reinforcement learning without reconstruction","venue":null,"work_id":null,"year":2006},"citing_paper":{"arxiv_id":"2502.00379","last_updated":"2025-06-12T16:28:52Z","snapshot_observed_at":"2026-08-10T10:34:42.717916Z","submitted_at":"2025-02-01T09:35:51Z","title":"Latent Action Learning Requires Supervision in the Presence of Distractors","version":5},"reference_index":65,"source":"arxiv_source","source_observed_at":"2026-08-09T19:18:45.167910Z"},"links":{"cited_paper":"/paper/2006.10742","citing_paper":"/paper/2502.00379"},"observation_digest":"sha256:7be49dcf7960c02f4867731fbf5828dcc222db48a20e932d3c74072b6e17353d","observation_id":"176cb31d-a95d-4667-a688-0828faf09e2f","resolution":{"observed_at":"2026-08-09T19:18:45.167910Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T19:18:45.989257Z","title":"Learning to drive by watching youtube videos: Action-conditioned contrastive policy pretraining","venue":null,"work_id":"591d3898-2ec7-439e-8b8e-4afd8a6756ff","year":2022},"citing_paper":{"arxiv_id":"2502.00379","last_updated":"2025-06-12T16:28:52Z","snapshot_observed_at":"2026-08-10T10:34:42.717916Z","submitted_at":"2025-02-01T09:35:51Z","title":"Latent Action Learning Requires Supervision in the Presence of Distractors","version":5},"reference_index":66,"source":"arxiv_source","source_observed_at":"2026-08-09T19:18:45.173254Z"},"links":{"citing_paper":"/paper/2502.00379"},"observation_digest":"sha256:8f1c0292c2b3ffd0bbdc35e0a943404eb205a14a9f3e433ffa70bf10cddd288e","observation_id":"912251a8-3910-4374-87a8-80418334859b","resolution":{"observed_at":"2026-08-09T19:18:45.994555Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2208.12345","last_updated":"2024-05-31T21:36:57Z","snapshot_observed_at":"2026-07-06T13:45:34.899866Z","submitted_at":"2022-08-25T21:08:01Z","title":"Light-weight probing of unsupervised representations for Reinforcement Learning","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2208.12345","snapshot_observed_at":"2026-08-09T19:18:45.177625Z","title":"Light-weight probing of unsupervised representations for reinforcement learning","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2502.00379","last_updated":"2025-06-12T16:28:52Z","snapshot_observed_at":"2026-08-10T10:34:42.717916Z","submitted_at":"2025-02-01T09:35:51Z","title":"Latent Action Learning Requires Supervision in the Presence of Distractors","version":5},"reference_index":67,"source":"arxiv_source","source_observed_at":"2026-08-09T19:18:45.177625Z"},"links":{"cited_paper":"/paper/2208.12345","citing_paper":"/paper/2502.00379"},"observation_digest":"sha256:d3a1461ba7d57ea2ce0098fc0057f368066e769edb83f3593b5e17cc7dfcc7ac","observation_id":"59d3ea8d-0813-45b5-b78a-2ea17c9d353e","resolution":{"observed_at":"2026-08-09T19:18:45.177625Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T19:18:45.972756Z","title":"Simplified temporal consistency reinforcement learning","venue":null,"work_id":"41cb2ea0-47b1-403c-8663-68571192852a","year":2023},"citing_paper":{"arxiv_id":"2502.00379","last_updated":"2025-06-12T16:28:52Z","snapshot_observed_at":"2026-08-10T10:34:42.717916Z","submitted_at":"2025-02-01T09:35:51Z","title":"Latent Action Learning Requires Supervision in the Presence of Distractors","version":5},"reference_index":68,"source":"arxiv_source","source_observed_at":"2026-08-09T19:18:45.182227Z"},"links":{"citing_paper":"/paper/2502.00379"},"observation_digest":"sha256:3960b9441be8af2e4eb52c1147cf2cba60d0cbda791f39df5085175b89d0ddf7","observation_id":"160252ad-04a1-433c-9ead-e762bd16563a","resolution":{"observed_at":"2026-08-09T19:18:45.978180Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T19:18:45.955433Z","title":"Semi-supervised offline reinforcement learning with action-free trajectories","venue":null,"work_id":"e9ff944a-0fcc-420c-8317-c081f8c575db","year":2023},"citing_paper":{"arxiv_id":"2502.00379","last_updated":"2025-06-12T16:28:52Z","snapshot_observed_at":"2026-08-10T10:34:42.717916Z","submitted_at":"2025-02-01T09:35:51Z","title":"Latent Action Learning Requires Supervision in the Presence of Distractors","version":5},"reference_index":69,"source":"arxiv_source","source_observed_at":"2026-08-09T19:18:45.186546Z"},"links":{"citing_paper":"/paper/2502.00379"},"observation_digest":"sha256:861a1c00164b80fb65ed99cda07bb6467d7c6b1d79f6f4e6a6304bdb96e5258d","observation_id":"1459ea55-e4ac-4369-9e56-ed1562603093","resolution":{"observed_at":"2026-08-09T19:18:45.960785Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T19:18:45.938412Z","title":"Learning robust representation for reinforcement learning with distractions by reward sequence prediction","venue":null,"work_id":"222b7845-c634-4015-969c-aa30502c75e0","year":2023},"citing_paper":{"arxiv_id":"2502.00379","last_updated":"2025-06-12T16:28:52Z","snapshot_observed_at":"2026-08-10T10:34:42.717916Z","submitted_at":"2025-02-01T09:35:51Z","title":"Latent Action Learning Requires Supervision in the Presence of Distractors","version":5},"reference_index":70,"source":"arxiv_source","source_observed_at":"2026-08-09T19:18:45.190967Z"},"links":{"citing_paper":"/paper/2502.00379"},"observation_digest":"sha256:6eedce4f09920ec2b066adb86ac1f0c70ae26fddf85dd75cb373b750853c2d9a","observation_id":"5503267f-a31c-4d97-a867-3fdb5c588d02","resolution":{"observed_at":"2026-08-09T19:18:45.943879Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-09T19:18:45.921166Z","title":"Repo: Resilient model-based reinforcement learning by regularizing posterior predictability","venue":null,"work_id":"ecc37380-c8c0-42ca-b1fd-81c65aa92391","year":2023},"citing_paper":{"arxiv_id":"2502.00379","last_updated":"2025-06-12T16:28:52Z","snapshot_observed_at":"2026-08-10T10:34:42.717916Z","submitted_at":"2025-02-01T09:35:51Z","title":"Latent Action Learning Requires Supervision in the Presence of Distractors","version":5},"reference_index":71,"source":"arxiv_source","source_observed_at":"2026-08-09T19:18:45.195892Z"},"links":{"citing_paper":"/paper/2502.00379"},"observation_digest":"sha256:dbbf1f1baf1cae37d64f77512f07e67b56fdcf962064c2f9742a0f1978b3f810","observation_id":"c3f296bd-af34-436d-b87b-284f786561d6","resolution":{"observed_at":"2026-08-09T19:18:45.927189Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}}],"paper":{"arxiv_id":"2502.00379","last_updated":"2025-06-12T16:28:52Z","latest_version":5,"primary_category":"cs.CV","snapshot_observed_at":"2026-08-10T10:34:42.717916Z","submitted_at":"2025-02-01T09:35:51Z","title":"Latent Action Learning Requires Supervision in the Presence of Distractors"},"reference_resolution":{"displayed":71,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":42,"verified_exact":5,"verified_fuzzy":24},"total_outbound_references":71},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"thesis":"As of 10 August 2026, this Paper Citation Record lists 71 of 71 outbound references and 11 inbound Pith citation observations for arXiv:2502.00379."}