{"as_of":"2026-08-21T20:43:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:b1c0879846854a2140f1687a6c4af84dfacbc5b59f28aec5cfc3a8f7da4efe7f","coverage":[{"denominator":77,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":77,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-06T15:57:01.366993Z","state":"measured"},{"denominator":78,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":78,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-21T06:32:19.484+00:00","state":"measured"},{"denominator":1,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":1,"source":"paper_references, paper_reference_links","source_observed_at":"2026-05-08T13:52:43.033237Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"arxiv_reference","source_observed_at":"2026-05-11T18:46:10.774659Z","state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2507.14748","last_updated":"2025-07-19T20:48:46Z","snapshot_observed_at":"2026-08-15T18:16:12.405822Z","submitted_at":"2025-07-19T20:48:46Z","title":"Skill Learning via Policy Diversity Yields Identifiable Representations for Reinforcement Learning","version":1},"cited_work":{"arxiv_id":"2507.14748","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2507.14748","snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Skill learning via policy diversity yields identifiable representations for reinforcement learning","venue":null,"work_id":"b6d5d381-7f56-4c05-8b35-9d880e092601","year":2025},"citing_paper":{"arxiv_id":"2605.06145","last_updated":"2026-05-07T12:40:49Z","snapshot_observed_at":"2026-08-15T00:46:32.680520Z","submitted_at":"2026-05-07T12:40:49Z","title":"Unifying Goal-Conditioned RL and Unsupervised Skill Learning via Control-Maximization","version":1},"reference_index":60,"source":"pdf_text","source_observed_at":"2026-05-08T13:52:43.033237Z"},"links":{"cited_paper":"/paper/2507.14748","citing_paper":"/paper/2605.06145"},"observation_digest":"sha256:83f9881363cdc91db032907da4351f1ecb69f058a2092a4c4a51cc32944623ab","observation_id":"fddea20a-55cc-4c8e-89b2-870e83a32e70","resolution":{"observed_at":"2026-05-11T18:46:10.776690Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}}],"links":{"evidence":"/evidence","html":"/paper/2507.14748/citation-record","integrity":"/paper/2507.14748/integrity","json":"/paper/2507.14748/citation-record.json","paper":"/paper/2507.14748"},"outbound":[{"citation":{"cited_paper":{"arxiv_id":"1807.10299","last_updated":"2018-07-26T18:05:45Z","snapshot_observed_at":"2026-08-14T18:47:19.380727Z","submitted_at":"2018-07-26T18:05:45Z","title":"Variational Option Discovery Algorithms","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1807.10299","snapshot_observed_at":"2026-08-06T15:56:53.346720Z","title":"Variational option discovery algorithms","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2507.14748","last_updated":"2025-07-19T20:48:46Z","snapshot_observed_at":"2026-08-15T18:16:12.405822Z","submitted_at":"2025-07-19T20:48:46Z","title":"Skill Learning via Policy Diversity Yields Identifiable Representations for Reinforcement Learning","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-06T15:56:53.346720Z"},"links":{"cited_paper":"/paper/1807.10299","citing_paper":"/paper/2507.14748"},"observation_digest":"sha256:4b8dfcfd22dcd751cc23ad6edf042e84e74aa6e653c4dee328ddbb766f2f54e7","observation_id":"fc139d4b-d7ff-4d8a-9808-103d570122ff","resolution":{"observed_at":"2026-08-06T15:56:53.346720Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2402.01399","last_updated":"2024-10-15T13:16:13Z","snapshot_observed_at":"2026-08-19T05:46:02.297330Z","submitted_at":"2024-02-02T13:31:17Z","title":"A Probabilistic Model Behind Self-Supervised Learning","version":3},"cited_work":{"arxiv_id":"2402.01399","doi":null,"metadata_source":"pith","pith_arxiv_id":"2402.01399","snapshot_observed_at":"2026-08-06T15:57:04.021257Z","title":"A Probabilistic Model Behind Self-Supervised Learning","venue":"cs.LG","work_id":"31df0f7e-7e74-45fd-b798-27346e38b165","year":2024},"citing_paper":{"arxiv_id":"2507.14748","last_updated":"2025-07-19T20:48:46Z","snapshot_observed_at":"2026-08-15T18:16:12.405822Z","submitted_at":"2025-07-19T20:48:46Z","title":"Skill Learning via Policy Diversity Yields Identifiable Representations for Reinforcement Learning","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-06T15:56:53.588444Z"},"links":{"cited_paper":"/paper/2402.01399","citing_paper":"/paper/2507.14748"},"observation_digest":"sha256:f6aca354d1f30ef5f82f253bbd7874360d8464c1689bc714d67a3c926f1c3d21","observation_id":"84416315-b512-400e-a7bd-85f7a3164e71","resolution":{"observed_at":"2026-08-06T15:57:04.081831Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T15:57:05.352340Z","title":"Large-Scale Study of Curiosity-Driven Learning","venue":null,"work_id":"ab2672e6-ae25-4ca6-a8d0-e4179f5c5612","year":null},"citing_paper":{"arxiv_id":"2507.14748","last_updated":"2025-07-19T20:48:46Z","snapshot_observed_at":"2026-08-15T18:16:12.405822Z","submitted_at":"2025-07-19T20:48:46Z","title":"Skill Learning via Policy Diversity Yields Identifiable Representations for Reinforcement Learning","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-06T15:56:53.821931Z"},"links":{"citing_paper":"/paper/2507.14748"},"observation_digest":"sha256:e9bdfd896a9d38deeed741f539dfdb0b22a07c7e53463380fe547d422a0b4eb0","observation_id":"6a78414d-e5f8-4018-9c15-69d6b516ad85","resolution":{"observed_at":"2026-08-06T15:57:05.357197Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2002.05709","last_updated":"2020-07-01T00:09:08Z","snapshot_observed_at":"2026-08-15T20:49:51.676387Z","submitted_at":"2020-02-13T18:50:45Z","title":"A Simple Framework for Contrastive Learning of Visual Representations","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2002.05709","snapshot_observed_at":"2026-08-06T15:56:53.882919Z","title":"A Simple Framework for Contrastive Learning of Visual Representations","venue":null,"work_id":null,"year":2002},"citing_paper":{"arxiv_id":"2507.14748","last_updated":"2025-07-19T20:48:46Z","snapshot_observed_at":"2026-08-15T18:16:12.405822Z","submitted_at":"2025-07-19T20:48:46Z","title":"Skill Learning via Policy Diversity Yields Identifiable Representations for Reinforcement Learning","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-06T15:56:53.882919Z"},"links":{"cited_paper":"/paper/2002.05709","citing_paper":"/paper/2507.14748"},"observation_digest":"sha256:43cb41fb613a05f9673d93d867e1aac32dbca67681e5b18b75d8a869c903c582","observation_id":"9511bc6a-7463-452e-85ec-7ff3df3d3dfb","resolution":{"observed_at":"2026-08-06T15:56:53.882919Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T15:57:05.337170Z","title":"Varia- tional Empowerment as Representation Learning for Goal-Conditioned Reinforcement Learning","venue":null,"work_id":"0991c668-f133-4a1a-b2a5-35d4d87243d3","year":1953},"citing_paper":{"arxiv_id":"2507.14748","last_updated":"2025-07-19T20:48:46Z","snapshot_observed_at":"2026-08-15T18:16:12.405822Z","submitted_at":"2025-07-19T20:48:46Z","title":"Skill Learning via Policy Diversity Yields Identifiable Representations for Reinforcement Learning","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-06T15:56:53.947155Z"},"links":{"citing_paper":"/paper/2507.14748"},"observation_digest":"sha256:b6d7b4cc77f84acb605564ccf677ffed4892a8affee0622a82b308d5a3492ad0","observation_id":"f9cd7a29-86ec-44e0-9b00-bb9a1444bc6c","resolution":{"observed_at":"2026-08-06T15:57:05.341973Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T15:57:05.321404Z","title":"Analyse des liaisons de probabilité","venue":null,"work_id":"89013637-04ba-48a0-817e-19d750594573","year":1947},"citing_paper":{"arxiv_id":"2507.14748","last_updated":"2025-07-19T20:48:46Z","snapshot_observed_at":"2026-08-15T18:16:12.405822Z","submitted_at":"2025-07-19T20:48:46Z","title":"Skill Learning via Policy Diversity Yields Identifiable Representations for Reinforcement Learning","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-06T15:56:54.031118Z"},"links":{"citing_paper":"/paper/2507.14748"},"observation_digest":"sha256:dbe8f39be58a43918e33bf8917470441e85371977851a6b47410df8c45308c25","observation_id":"d57e1b78-ae1c-4bb1-bbc6-c7e6f4071329","resolution":{"observed_at":"2026-08-06T15:57:05.326291Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T15:57:05.304874Z","title":"A Survey of State Representation Learning for Deep Reinforcement Learning","venue":null,"work_id":"3d8bb8fd-a63e-45fa-a45a-684d5cf2c97b","year":2025},"citing_paper":{"arxiv_id":"2507.14748","last_updated":"2025-07-19T20:48:46Z","snapshot_observed_at":"2026-08-15T18:16:12.405822Z","submitted_at":"2025-07-19T20:48:46Z","title":"Skill Learning via Policy Diversity Yields Identifiable Representations for Reinforcement Learning","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-06T15:56:54.083100Z"},"links":{"citing_paper":"/paper/2507.14748"},"observation_digest":"sha256:8837d74426dd8fc270a33ad709fcb1f4cd24651cb8f84f4a40214741cfa9af4e","observation_id":"5c750ad4-d147-42d1-a499-6146bc7e9a4e","resolution":{"observed_at":"2026-08-06T15:57:05.309845Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1802.06070","last_updated":"2018-10-09T23:19:52Z","snapshot_observed_at":"2026-08-14T19:45:07.867570Z","submitted_at":"2018-02-16T18:57:57Z","title":"Diversity is All You Need: Learning Skills without a Reward Function","version":6},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1802.06070","snapshot_observed_at":"2026-08-06T15:56:54.147425Z","title":"Diversity is All You Need: Learning Skills without a Reward Function, October 2018","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2507.14748","last_updated":"2025-07-19T20:48:46Z","snapshot_observed_at":"2026-08-15T18:16:12.405822Z","submitted_at":"2025-07-19T20:48:46Z","title":"Skill Learning via Policy Diversity Yields Identifiable Representations for Reinforcement Learning","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-06T15:56:54.147425Z"},"links":{"cited_paper":"/paper/1802.06070","citing_paper":"/paper/2507.14748"},"observation_digest":"sha256:a635270b69dac3ceebd08d09e60a8f5c32f44f4a07cc41d53389e276efd7e856","observation_id":"4e63888f-9e2d-4d4b-ae1c-ac3a3bed76b5","resolution":{"observed_at":"2026-08-06T15:56:54.147425Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T15:57:05.289468Z","title":"Salakhutdi- nov","venue":null,"work_id":"83da864d-16c4-4dc0-9c54-512267e87b79","year":null},"citing_paper":{"arxiv_id":"2507.14748","last_updated":"2025-07-19T20:48:46Z","snapshot_observed_at":"2026-08-15T18:16:12.405822Z","submitted_at":"2025-07-19T20:48:46Z","title":"Skill Learning via Policy Diversity Yields Identifiable Representations for Reinforcement Learning","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-06T15:56:54.287029Z"},"links":{"citing_paper":"/paper/2507.14748"},"observation_digest":"sha256:a1d99034e2978155c07619d79b1d4d4f03cafc267bb12f264446548af255f960","observation_id":"992877dc-bd99-41b6-8206-e1bf7952c6b7","resolution":{"observed_at":"2026-08-06T15:57:05.294233Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T15:57:05.252233Z","title":"Contrastive Representations Make Planning Easy","venue":null,"work_id":"d8b6706b-a925-409b-887f-e75056850c37","year":2023},"citing_paper":{"arxiv_id":"2507.14748","last_updated":"2025-07-19T20:48:46Z","snapshot_observed_at":"2026-08-15T18:16:12.405822Z","submitted_at":"2025-07-19T20:48:46Z","title":"Skill Learning via Policy Diversity Yields Identifiable Representations for Reinforcement Learning","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-06T15:56:54.509083Z"},"links":{"citing_paper":"/paper/2507.14748"},"observation_digest":"sha256:0dfa5031fb56798496364997494aba5c84eed44c17e82be21e3dfe56c4c8fb16","observation_id":"038088b2-cc83-4ca0-b68c-7da92f699276","resolution":{"observed_at":"2026-08-06T15:57:05.257469Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T15:57:05.237481Z","title":"Wichmann","venue":null,"work_id":"2b7566e3-58b1-41ce-92e1-880cd3b3bf25","year":2020},"citing_paper":{"arxiv_id":"2507.14748","last_updated":"2025-07-19T20:48:46Z","snapshot_observed_at":"2026-08-15T18:16:12.405822Z","submitted_at":"2025-07-19T20:48:46Z","title":"Skill Learning via Policy Diversity Yields Identifiable Representations for Reinforcement Learning","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-06T15:56:54.609736Z"},"links":{"citing_paper":"/paper/2507.14748"},"observation_digest":"sha256:d556a40135a225f64c0af2903cbc15b6b90cfc10961a2083068b0abdcba3be54","observation_id":"57037876-c6d0-4bad-b1fb-9db86ccecdd5","resolution":{"observed_at":"2026-08-06T15:57:05.242054Z","resolver_source":"raw_fallback","status":"malformed_identifier"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T15:57:05.222129Z","title":"Variational Intrinsic Control","venue":null,"work_id":"bd92dfa8-9a12-4ca0-b0ee-f64577ef7f1a","year":2017},"citing_paper":{"arxiv_id":"2507.14748","last_updated":"2025-07-19T20:48:46Z","snapshot_observed_at":"2026-08-15T18:16:12.405822Z","submitted_at":"2025-07-19T20:48:46Z","title":"Skill Learning via Policy Diversity Yields Identifiable Representations for Reinforcement Learning","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-06T15:56:54.738230Z"},"links":{"citing_paper":"/paper/2507.14748"},"observation_digest":"sha256:d91c3385a9ae35bdadb56679df36f3c3bfade1024746fa584124e84f1616042f","observation_id":"d6ff4a52-4fbf-436f-8400-a2a8c8f68849","resolution":{"observed_at":"2026-08-06T15:57:05.226619Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1905.06642","last_updated":"2019-08-01T09:57:35Z","snapshot_observed_at":"2026-08-14T16:31:20.502578Z","submitted_at":"2019-05-16T10:27:04Z","title":"The Incomplete Rosetta Stone Problem: Identifiability Results for Multi-View Nonlinear ICA","version":2},"cited_work":{"arxiv_id":"1905.06642","doi":null,"metadata_source":"pith","pith_arxiv_id":"1905.06642","snapshot_observed_at":"2026-08-06T15:57:03.739967Z","title":"The Incomplete Rosetta Stone Problem: Identifiability Results for Multi-View Nonlinear ICA","venue":"stat.ML","work_id":"894a86b6-32da-494d-8241-b924ec630aa2","year":2019},"citing_paper":{"arxiv_id":"2507.14748","last_updated":"2025-07-19T20:48:46Z","snapshot_observed_at":"2026-08-15T18:16:12.405822Z","submitted_at":"2025-07-19T20:48:46Z","title":"Skill Learning via Policy Diversity Yields Identifiable Representations for Reinforcement Learning","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-06T15:56:54.785815Z"},"links":{"cited_paper":"/paper/1905.06642","citing_paper":"/paper/2507.14748"},"observation_digest":"sha256:b18acea41e5c427ba8acf0cf782c9a7f5fa30b8c4c79068d3ecd33bc608b68b5","observation_id":"520a7abc-e7bf-469b-9a29-6bcdf6f4055f","resolution":{"observed_at":"2026-08-06T15:57:03.836978Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1803.10122","last_updated":"2018-05-09T09:06:27Z","snapshot_observed_at":"2026-08-18T07:04:58.690133Z","submitted_at":"2018-03-27T15:08:55Z","title":"World Models","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1803.10122","snapshot_observed_at":"2026-08-06T15:56:54.882452Z","title":"World Models","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2507.14748","last_updated":"2025-07-19T20:48:46Z","snapshot_observed_at":"2026-08-15T18:16:12.405822Z","submitted_at":"2025-07-19T20:48:46Z","title":"Skill Learning via Policy Diversity Yields Identifiable Representations for Reinforcement Learning","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-06T15:56:54.882452Z"},"links":{"cited_paper":"/paper/1803.10122","citing_paper":"/paper/2507.14748"},"observation_digest":"sha256:da185e8a4352015092dcfd644aec7c415c3d124ff79081ce4021ef4b71b4bde1","observation_id":"bc9739c7-521c-4f37-aa05-8b5ab77751c3","resolution":{"observed_at":"2026-08-06T15:56:54.882452Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T15:57:05.205987Z","title":"Fast Task Inference with Variational Intrinsic Successor Features","venue":null,"work_id":"a285bf93-380b-44ec-ae09-faa48322b18d","year":null},"citing_paper":{"arxiv_id":"2507.14748","last_updated":"2025-07-19T20:48:46Z","snapshot_observed_at":"2026-08-15T18:16:12.405822Z","submitted_at":"2025-07-19T20:48:46Z","title":"Skill Learning via Policy Diversity Yields Identifiable Representations for Reinforcement Learning","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-06T15:56:54.987426Z"},"links":{"citing_paper":"/paper/2507.14748"},"observation_digest":"sha256:7a48daf31da8d4576e1cd4d4e1aa0b7c1ea549b910ea7fd4c66f678980ba0f39","observation_id":"65f8b3e2-b2de-4c2d-8959-dd8a44173ada","resolution":{"observed_at":"2026-08-06T15:57:05.211157Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T15:57:05.172610Z","title":"Momentum contrast for unsupervised visual representation learning","venue":null,"work_id":"5708bc4e-86cb-42f5-8bbd-b4588a09c1d6","year":2020},"citing_paper":{"arxiv_id":"2507.14748","last_updated":"2025-07-19T20:48:46Z","snapshot_observed_at":"2026-08-15T18:16:12.405822Z","submitted_at":"2025-07-19T20:48:46Z","title":"Skill Learning via Policy Diversity Yields Identifiable Representations for Reinforcement Learning","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-06T15:56:55.126819Z"},"links":{"citing_paper":"/paper/2507.14748"},"observation_digest":"sha256:1ac10e9232915ca6edb29e1d23fe0ac405052eb6439159bd95d074f1c98d8832","observation_id":"007cd563-9818-4bdf-a81e-1d50a63431ff","resolution":{"observed_at":"2026-08-06T15:57:05.178309Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1605.06336","last_updated":"2016-05-20T12:59:22Z","snapshot_observed_at":"2026-08-19T20:52:27.342838Z","submitted_at":"2016-05-20T12:59:22Z","title":"Unsupervised Feature Extraction by Time-Contrastive Learning and Nonlinear ICA","version":1},"cited_work":{"arxiv_id":"1605.06336","doi":null,"metadata_source":"pith","pith_arxiv_id":"1605.06336","snapshot_observed_at":"2026-08-06T15:57:03.562344Z","title":"Unsupervised Feature Extraction by Time-Contrastive Learning and Nonlinear ICA","venue":"stat.ML","work_id":"ceb62dc8-311d-4264-a8ad-b5846a03e5eb","year":2016},"citing_paper":{"arxiv_id":"2507.14748","last_updated":"2025-07-19T20:48:46Z","snapshot_observed_at":"2026-08-15T18:16:12.405822Z","submitted_at":"2025-07-19T20:48:46Z","title":"Skill Learning via Policy Diversity Yields Identifiable Representations for Reinforcement Learning","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-06T15:56:55.202038Z"},"links":{"cited_paper":"/paper/1605.06336","citing_paper":"/paper/2507.14748"},"observation_digest":"sha256:4de35daaa9779f476aa3650f1ab977e4b9fa6f19977419f0ccc1c23b575b9307","observation_id":"ce2e51ab-5b29-4241-b335-b5a24f255992","resolution":{"observed_at":"2026-08-06T15:57:03.613959Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1805.08651","last_updated":"2019-02-04T15:17:01Z","snapshot_observed_at":"2026-08-20T02:13:28.908470Z","submitted_at":"2018-05-22T15:01:22Z","title":"Nonlinear ICA Using Auxiliary Variables and Generalized Contrastive Learning","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1805.08651","snapshot_observed_at":"2026-08-06T15:56:55.289803Z","title":null,"venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2507.14748","last_updated":"2025-07-19T20:48:46Z","snapshot_observed_at":"2026-08-15T18:16:12.405822Z","submitted_at":"2025-07-19T20:48:46Z","title":"Skill Learning via Policy Diversity Yields Identifiable Representations for Reinforcement Learning","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-06T15:56:55.289803Z"},"links":{"cited_paper":"/paper/1805.08651","citing_paper":"/paper/2507.14748"},"observation_digest":"sha256:6cf51cb61a9c459212d4ef1ef6b464e5ea6ccacf9f572273c6efc702db29a080","observation_id":"ea2d45fe-1b1c-429e-a383-e45218786c93","resolution":{"observed_at":"2026-08-06T15:56:55.289803Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T15:56:55.353431Z","title":"Nonlinear independent component analysis: Existence and uniqueness results","venue":null,"work_id":null,"year":1999},"citing_paper":{"arxiv_id":"2507.14748","last_updated":"2025-07-19T20:48:46Z","snapshot_observed_at":"2026-08-15T18:16:12.405822Z","submitted_at":"2025-07-19T20:48:46Z","title":"Skill Learning via Policy Diversity Yields Identifiable Representations for Reinforcement Learning","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-06T15:56:55.353431Z"},"links":{"citing_paper":"/paper/2507.14748"},"observation_digest":"sha256:00753a9d2b8c4354d39d9f3c20bcd874f3a16825fa2dabf2754490c4e48363ab","observation_id":"14d2673a-fcb0-40e3-84d5-fabd4005bfa7","resolution":{"observed_at":"2026-08-06T15:56:55.353431Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2106.09620","last_updated":"2021-10-27T11:19:39Z","snapshot_observed_at":"2026-08-16T18:16:20.740764Z","submitted_at":"2021-06-17T15:56:57Z","title":"Disentangling Identifiable Features from Noisy Data with Structured Nonlinear ICA","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2106.09620","snapshot_observed_at":"2026-08-06T15:56:55.422423Z","title":"Disentangling Identifiable Features from Noisy Data with Structured Nonlinear ICA","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2507.14748","last_updated":"2025-07-19T20:48:46Z","snapshot_observed_at":"2026-08-15T18:16:12.405822Z","submitted_at":"2025-07-19T20:48:46Z","title":"Skill Learning via Policy Diversity Yields Identifiable Representations for Reinforcement Learning","version":1},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-06T15:56:55.422423Z"},"links":{"cited_paper":"/paper/2106.09620","citing_paper":"/paper/2507.14748"},"observation_digest":"sha256:bdb861c2692721bedb5f13f27a837b2e7c06dbc6492d57915108ff5683452cca","observation_id":"dd8db151-85d0-40e8-ac90-633cd01f57e1","resolution":{"observed_at":"2026-08-06T15:56:55.422423Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2406.10743","last_updated":"2024-06-15T21:42:15Z","snapshot_observed_at":"2026-08-16T16:33:20.110992Z","submitted_at":"2024-06-15T21:42:15Z","title":"Occam's Razor for Self Supervised Learning: What is Sufficient to Learn Good Representations?","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2406.10743","snapshot_observed_at":"2026-08-06T15:56:55.526192Z","title":"Occam’s Razor for Self Supervised Learning: What is Sufficient to Learn Good Representations?, June 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.14748","last_updated":"2025-07-19T20:48:46Z","snapshot_observed_at":"2026-08-15T18:16:12.405822Z","submitted_at":"2025-07-19T20:48:46Z","title":"Skill Learning via Policy Diversity Yields Identifiable Representations for Reinforcement Learning","version":1},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-06T15:56:55.526192Z"},"links":{"cited_paper":"/paper/2406.10743","citing_paper":"/paper/2507.14748"},"observation_digest":"sha256:1bbdb6cc5113ed5c5a86fe19d30f179920e6db90d9569aba799bb630777d5ffa","observation_id":"9c3ebaac-bc05-4e5e-809d-e72152281d3b","resolution":{"observed_at":"2026-08-06T15:56:55.526192Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T15:57:05.156583Z","title":"Variational Autoencoders and Nonlinear ICA: A Unifying Framework","venue":null,"work_id":"dd055b68-fa4c-4054-a0e1-d961d622d5d8","year":2020},"citing_paper":{"arxiv_id":"2507.14748","last_updated":"2025-07-19T20:48:46Z","snapshot_observed_at":"2026-08-15T18:16:12.405822Z","submitted_at":"2025-07-19T20:48:46Z","title":"Skill Learning via Policy Diversity Yields Identifiable Representations for Reinforcement Learning","version":1},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-06T15:56:55.599606Z"},"links":{"citing_paper":"/paper/2507.14748"},"observation_digest":"sha256:b815a4e6e62bab6aa31e31534f3642ef82eb546454dea4dc118526fcf264991a","observation_id":"d1e840fc-11f8-400d-848b-482bc3162c14","resolution":{"observed_at":"2026-08-06T15:57:05.161269Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2002.11537","last_updated":"2020-10-26T17:49:11Z","snapshot_observed_at":"2026-08-21T16:20:55.217502Z","submitted_at":"2020-02-26T14:43:30Z","title":"ICE-BeeM: Identifiable Conditional Energy-Based Deep Models Based on Nonlinear ICA","version":4},"cited_work":{"arxiv_id":"2002.11537","doi":null,"metadata_source":"pith","pith_arxiv_id":"2002.11537","snapshot_observed_at":"2026-08-06T15:57:03.352957Z","title":"ICE-BeeM: Identifiable Conditional Energy-Based Deep Models Based on Nonlinear ICA","venue":"stat.ML","work_id":"57a5ae47-8a6f-49fc-9089-f26be9e9dddc","year":2020},"citing_paper":{"arxiv_id":"2507.14748","last_updated":"2025-07-19T20:48:46Z","snapshot_observed_at":"2026-08-15T18:16:12.405822Z","submitted_at":"2025-07-19T20:48:46Z","title":"Skill Learning via Policy Diversity Yields Identifiable Representations for Reinforcement Learning","version":1},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-06T15:56:55.665581Z"},"links":{"cited_paper":"/paper/2002.11537","citing_paper":"/paper/2507.14748"},"observation_digest":"sha256:fb248d09ea644af28fb540619fcf70785535729d0c3d0aa7d0575986dcba6773","observation_id":"4a1b04dc-0abe-430a-9b5d-5ad16aee3729","resolution":{"observed_at":"2026-08-06T15:57:03.389080Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T15:57:05.137254Z","title":"Unsupervised Reinforcement Learning with Contrastive Intrinsic Con- trol","venue":null,"work_id":"c17e16d9-09cc-4dca-9a75-caa0312b344a","year":2022},"citing_paper":{"arxiv_id":"2507.14748","last_updated":"2025-07-19T20:48:46Z","snapshot_observed_at":"2026-08-15T18:16:12.405822Z","submitted_at":"2025-07-19T20:48:46Z","title":"Skill Learning via Policy Diversity Yields Identifiable Representations for Reinforcement Learning","version":1},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-06T15:56:55.743381Z"},"links":{"citing_paper":"/paper/2507.14748"},"observation_digest":"sha256:a4a629d6e9e5cfc92403a3bc98b49faff1ec4e32cbc8976440a221b2dec77e26","observation_id":"46f0ea1d-759e-4c41-97ee-30107decabfb","resolution":{"observed_at":"2026-08-06T15:57:05.143749Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2202.03169","last_updated":"2022-06-15T13:39:56Z","snapshot_observed_at":"2026-08-21T20:25:15.940847Z","submitted_at":"2022-02-07T13:55:36Z","title":"CITRIS: Causal Identifiability from Temporal Intervened Sequences","version":3},"cited_work":{"arxiv_id":"2202.03169","doi":null,"metadata_source":"pith","pith_arxiv_id":"2202.03169","snapshot_observed_at":"2026-08-06T15:57:03.176965Z","title":"CITRIS: Causal Identifiability from Temporal Intervened Sequences","venue":"cs.LG","work_id":"492e9059-83fc-46f7-88f2-20f5ea75425a","year":2022},"citing_paper":{"arxiv_id":"2507.14748","last_updated":"2025-07-19T20:48:46Z","snapshot_observed_at":"2026-08-15T18:16:12.405822Z","submitted_at":"2025-07-19T20:48:46Z","title":"Skill Learning via Policy Diversity Yields Identifiable Representations for Reinforcement Learning","version":1},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-08-06T15:56:55.835942Z"},"links":{"cited_paper":"/paper/2202.03169","citing_paper":"/paper/2507.14748"},"observation_digest":"sha256:57b0a96b061e89881fec957b76e58cc2be3450ccf9500aa0fe90bc24c029e3c3","observation_id":"e239c16d-cdae-4e06-afa5-19271d9e6f17","resolution":{"observed_at":"2026-08-06T15:57:03.266010Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T15:57:05.117778Z","title":"Asano, Taco Cohen, and Efstratios Gavves","venue":null,"work_id":"95d11902-7922-4d6f-a8c7-0375483230d7","year":null},"citing_paper":{"arxiv_id":"2507.14748","last_updated":"2025-07-19T20:48:46Z","snapshot_observed_at":"2026-08-15T18:16:12.405822Z","submitted_at":"2025-07-19T20:48:46Z","title":"Skill Learning via Policy Diversity Yields Identifiable Representations for Reinforcement Learning","version":1},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-08-06T15:56:55.933246Z"},"links":{"citing_paper":"/paper/2507.14748"},"observation_digest":"sha256:1db474b8ce281d82361d4d3df4885f8e06011c3039d99693935b43e0f2232290","observation_id":"4c83cd9b-9ec9-46cb-aa23-0d76c3af4ea0","resolution":{"observed_at":"2026-08-06T15:57:05.123132Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2408.05804","last_updated":"2024-08-11T15:49:00Z","snapshot_observed_at":"2026-08-16T13:27:10.475681Z","submitted_at":"2024-08-11T15:49:00Z","title":"A Single Goal is All You Need: Skills and Exploration Emerge from Contrastive RL without Rewards, Demonstrations, or Subgoals","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2408.05804","snapshot_observed_at":"2026-08-06T15:56:56.081279Z","title":"A Single Goal is All You Need: Skills and Exploration Emerge from Contrastive RL without Rewards, Demonstrations, or Subgoals, August 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.14748","last_updated":"2025-07-19T20:48:46Z","snapshot_observed_at":"2026-08-15T18:16:12.405822Z","submitted_at":"2025-07-19T20:48:46Z","title":"Skill Learning via Policy Diversity Yields Identifiable Representations for Reinforcement Learning","version":1},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-08-06T15:56:56.081279Z"},"links":{"cited_paper":"/paper/2408.05804","citing_paper":"/paper/2507.14748"},"observation_digest":"sha256:4c693849f96fab329562566db10335fd6414ee336333bb124438f3ddc42acc80","observation_id":"84216d40-7969-43ad-970a-15f13301d793","resolution":{"observed_at":"2026-08-06T15:56:56.081279Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2210.11464","last_updated":"2022-10-20T17:58:30Z","snapshot_observed_at":"2026-08-16T16:22:27.816200Z","submitted_at":"2022-10-20T17:58:30Z","title":"Self-Supervised Learning via Maximum Entropy Coding","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2210.11464","snapshot_observed_at":"2026-08-06T15:56:56.165584Z","title":"Self-Supervised Learning via Maximum Entropy Coding","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2507.14748","last_updated":"2025-07-19T20:48:46Z","snapshot_observed_at":"2026-08-15T18:16:12.405822Z","submitted_at":"2025-07-19T20:48:46Z","title":"Skill Learning via Policy Diversity Yields Identifiable Representations for Reinforcement Learning","version":1},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-08-06T15:56:56.165584Z"},"links":{"cited_paper":"/paper/2210.11464","citing_paper":"/paper/2507.14748"},"observation_digest":"sha256:ca94d9a51cdc5387400ff6ec9d724df0d4f0c69929888411812d01f4799e1672","observation_id":"f8c1c38b-6f90-4b77-8408-92414a93841c","resolution":{"observed_at":"2026-08-06T15:56:56.165584Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T15:57:05.100788Z","title":null,"venue":null,"work_id":"f1ef5165-62e1-4bb9-bbde-2970114e9d39","year":null},"citing_paper":{"arxiv_id":"2507.14748","last_updated":"2025-07-19T20:48:46Z","snapshot_observed_at":"2026-08-15T18:16:12.405822Z","submitted_at":"2025-07-19T20:48:46Z","title":"Skill Learning via Policy Diversity Yields Identifiable Representations for Reinforcement Learning","version":1},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-08-06T15:56:56.007714Z"},"links":{"citing_paper":"/paper/2507.14748"},"observation_digest":"sha256:b94ea430a58475edd256792e7d410edc33f587534c6f998689fdf46f5c1699f8","observation_id":"b292d8c2-9dab-4214-bdfe-66d8b5699f39","resolution":{"observed_at":"2026-08-06T15:57:05.105605Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T15:57:05.077277Z","title":"Challenging Common Assumptions in the Unsupervised Learning of Disentangled Representations","venue":null,"work_id":"3b794537-84e9-4108-b783-146faa2ca3f5","year":2019},"citing_paper":{"arxiv_id":"2507.14748","last_updated":"2025-07-19T20:48:46Z","snapshot_observed_at":"2026-08-15T18:16:12.405822Z","submitted_at":"2025-07-19T20:48:46Z","title":"Skill Learning via Policy Diversity Yields Identifiable Representations for Reinforcement Learning","version":1},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-08-06T15:56:56.340734Z"},"links":{"citing_paper":"/paper/2507.14748"},"observation_digest":"sha256:7af5ef3cebd263f73c7d688a89431b3ca66378e647fbe8682f0c6de5ce0a34d3","observation_id":"cb6ba701-b7df-420e-ae64-c777e65c5425","resolution":{"observed_at":"2026-08-06T15:57:05.085022Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2002.02886","last_updated":"2020-10-20T15:22:16Z","snapshot_observed_at":"2026-08-20T00:01:18.191666Z","submitted_at":"2020-02-07T16:39:31Z","title":"Weakly-Supervised Disentanglement Without Compromises","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2002.02886","snapshot_observed_at":"2026-08-06T15:56:56.400791Z","title":"Weakly-Supervised Disentanglement Without Compromises","venue":null,"work_id":null,"year":2002},"citing_paper":{"arxiv_id":"2507.14748","last_updated":"2025-07-19T20:48:46Z","snapshot_observed_at":"2026-08-15T18:16:12.405822Z","submitted_at":"2025-07-19T20:48:46Z","title":"Skill Learning via Policy Diversity Yields Identifiable Representations for Reinforcement Learning","version":1},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-08-06T15:56:56.400791Z"},"links":{"cited_paper":"/paper/2002.02886","citing_paper":"/paper/2507.14748"},"observation_digest":"sha256:5d2d1b9bb0c3945185734067a47c7aef4e6b7eed0bb71b70a10a939e8be22369","observation_id":"985da5ed-2f67-4b57-a492-234cd4f8675b","resolution":{"observed_at":"2026-08-06T15:56:56.400791Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2301.05169","last_updated":"2023-04-03T17:19:51Z","snapshot_observed_at":"2026-08-19T06:18:28.760036Z","submitted_at":"2023-01-12T17:43:38Z","title":"Causal Triplet: An Open Challenge for Intervention-centric Causal Representation Learning","version":2},"cited_work":{"arxiv_id":"2301.05169","doi":null,"metadata_source":"pith","pith_arxiv_id":"2301.05169","snapshot_observed_at":"2026-08-06T15:57:02.996410Z","title":"Causal Triplet: An Open Challenge for Intervention-centric Causal Representation Learning","venue":"cs.LG","work_id":"51d5d48a-46a9-4f36-8b22-c8bc538fa733","year":2023},"citing_paper":{"arxiv_id":"2507.14748","last_updated":"2025-07-19T20:48:46Z","snapshot_observed_at":"2026-08-15T18:16:12.405822Z","submitted_at":"2025-07-19T20:48:46Z","title":"Skill Learning via Policy Diversity Yields Identifiable Representations for Reinforcement Learning","version":1},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-08-06T15:56:56.249173Z"},"links":{"cited_paper":"/paper/2301.05169","citing_paper":"/paper/2507.14748"},"observation_digest":"sha256:d609332f9a801e84d637151da5a1888e87d5dbf51d8299035782f8a4d7bfad87","observation_id":"26734092-9e00-41a2-a75e-cf85a83e636c","resolution":{"observed_at":"2026-08-06T15:57:03.076796Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T15:57:05.053940Z","title":"Variational Information Maximisation for Intrinsically Motivated Reinforcement Learning","venue":null,"work_id":"3377fd80-e3e8-4790-8331-328e4f8b8c18","year":2015},"citing_paper":{"arxiv_id":"2507.14748","last_updated":"2025-07-19T20:48:46Z","snapshot_observed_at":"2026-08-15T18:16:12.405822Z","submitted_at":"2025-07-19T20:48:46Z","title":"Skill Learning via Policy Diversity Yields Identifiable Representations for Reinforcement Learning","version":1},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-08-06T15:56:56.545446Z"},"links":{"citing_paper":"/paper/2507.14748"},"observation_digest":"sha256:02e5f129c66427d427b8decb755afd243bed93e3cd72b5c36c343b6fb3f92d98","observation_id":"7eac9cb8-2ee2-4489-9aaf-c47fa0650fa3","resolution":{"observed_at":"2026-08-06T15:57:05.059341Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T15:57:05.034722Z","title":"Connectivity-contrastive learning: Combining causal discovery and representation learning for multimodal data","venue":null,"work_id":"01833d3a-5f54-438b-b0fe-29858657ee1c","year":2023},"citing_paper":{"arxiv_id":"2507.14748","last_updated":"2025-07-19T20:48:46Z","snapshot_observed_at":"2026-08-15T18:16:12.405822Z","submitted_at":"2025-07-19T20:48:46Z","title":"Skill Learning via Policy Diversity Yields Identifiable Representations for Reinforcement Learning","version":1},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-08-06T15:56:56.619425Z"},"links":{"citing_paper":"/paper/2507.14748"},"observation_digest":"sha256:857b077e5fa043c9b8ef88378566b067e5b71d5e7cd3eae17b99b3073c45a1ca","observation_id":"49fdb825-b482-4f09-81ae-dc168920863b","resolution":{"observed_at":"2026-08-06T15:57:05.040960Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2302.06604","last_updated":"2023-02-13T18:59:09Z","snapshot_observed_at":"2026-08-16T15:55:39.119391Z","submitted_at":"2023-02-13T18:59:09Z","title":"ALAN: Autonomously Exploring Robotic Agents in the Real World","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2302.06604","snapshot_observed_at":"2026-08-06T15:56:56.461728Z","title":"ALAN: Autonomously Exploring Robotic Agents in the Real World, February 2023","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2507.14748","last_updated":"2025-07-19T20:48:46Z","snapshot_observed_at":"2026-08-15T18:16:12.405822Z","submitted_at":"2025-07-19T20:48:46Z","title":"Skill Learning via Policy Diversity Yields Identifiable Representations for Reinforcement Learning","version":1},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-08-06T15:56:56.461728Z"},"links":{"cited_paper":"/paper/2302.06604","citing_paper":"/paper/2507.14748"},"observation_digest":"sha256:154861ec167d2bdc93a51223cf0d4551b4108ef15a0c90b91f1f56beb14ad79e","observation_id":"e281be36-6df0-4748-8d2b-b58f1c02c5eb","resolution":{"observed_at":"2026-08-06T15:56:56.461728Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1807.03748","last_updated":"2019-01-22T18:47:12Z","snapshot_observed_at":"2026-08-14T18:53:38.574749Z","submitted_at":"2018-07-10T16:52:11Z","title":"Representation Learning with Contrastive Predictive Coding","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1807.03748","snapshot_observed_at":"2026-08-06T15:56:56.830019Z","title":"Representation Learning with Contrastive Predictive Coding","venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2507.14748","last_updated":"2025-07-19T20:48:46Z","snapshot_observed_at":"2026-08-15T18:16:12.405822Z","submitted_at":"2025-07-19T20:48:46Z","title":"Skill Learning via Policy Diversity Yields Identifiable Representations for Reinforcement Learning","version":1},"reference_index":36,"source":"pdf_text","source_observed_at":"2026-08-06T15:56:56.830019Z"},"links":{"cited_paper":"/paper/1807.03748","citing_paper":"/paper/2507.14748"},"observation_digest":"sha256:005ca55b76804b38919d4b9ef7c6b8f97e78f2460d061edf2dd76a18b16ba066","observation_id":"5e58dcc9-e66d-467a-a275-52dafe816490","resolution":{"observed_at":"2026-08-06T15:56:56.830019Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2311.03658","last_updated":"2024-07-17T22:24:27Z","snapshot_observed_at":"2026-08-16T23:25:38.049210Z","submitted_at":"2023-11-07T01:59:11Z","title":"The Linear Representation Hypothesis and the Geometry of Large Language Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2311.03658","snapshot_observed_at":"2026-08-06T15:56:56.928220Z","title":"The Linear Representation Hypothesis and the Geometry of Large Language Models, November 2023","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2507.14748","last_updated":"2025-07-19T20:48:46Z","snapshot_observed_at":"2026-08-15T18:16:12.405822Z","submitted_at":"2025-07-19T20:48:46Z","title":"Skill Learning via Policy Diversity Yields Identifiable Representations for Reinforcement Learning","version":1},"reference_index":37,"source":"pdf_text","source_observed_at":"2026-08-06T15:56:56.928220Z"},"links":{"cited_paper":"/paper/2311.03658","citing_paper":"/paper/2507.14748"},"observation_digest":"sha256:0ff8a47ca6902b221b8f5da8bfca2fb1df81045e403084a97517a35e9b816b27","observation_id":"d116b630-6a22-40cb-b42e-584a19aa715f","resolution":{"observed_at":"2026-08-06T15:56:56.928220Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2006.10944","last_updated":"2021-02-26T02:25:22Z","snapshot_observed_at":"2026-08-10T16:50:30.524628Z","submitted_at":"2020-06-19T03:41:12Z","title":"Independent Innovation Analysis for Nonlinear Vector Autoregressive Process","version":2},"cited_work":{"arxiv_id":"2006.10944","doi":null,"metadata_source":"pith","pith_arxiv_id":"2006.10944","snapshot_observed_at":"2026-08-06T15:57:02.826866Z","title":"Independent Innovation Analysis for Nonlinear Vector Autoregressive Process","venue":"stat.ML","work_id":"051c7735-a7f5-41ae-a8d3-a1e193cfe9e4","year":2020},"citing_paper":{"arxiv_id":"2507.14748","last_updated":"2025-07-19T20:48:46Z","snapshot_observed_at":"2026-08-15T18:16:12.405822Z","submitted_at":"2025-07-19T20:48:46Z","title":"Skill Learning via Policy Diversity Yields Identifiable Representations for Reinforcement Learning","version":1},"reference_index":38,"source":"pdf_text","source_observed_at":"2026-08-06T15:56:56.735139Z"},"links":{"cited_paper":"/paper/2006.10944","citing_paper":"/paper/2507.14748"},"observation_digest":"sha256:9d28f80f89e917eb658b05576b6763b2fad460366e1dddcc63d72a531cf42294","observation_id":"dead8afa-0f32-4970-9c4f-514f48b523f6","resolution":{"observed_at":"2026-08-06T15:57:02.873559Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T15:57:05.019083Z","title":"Lipschitz- constrained Unsupervised Skill Discovery","venue":null,"work_id":"efaccde1-063f-4442-bcf1-2e88e32f6bce","year":2021},"citing_paper":{"arxiv_id":"2507.14748","last_updated":"2025-07-19T20:48:46Z","snapshot_observed_at":"2026-08-15T18:16:12.405822Z","submitted_at":"2025-07-19T20:48:46Z","title":"Skill Learning via Policy Diversity Yields Identifiable Representations for Reinforcement Learning","version":1},"reference_index":39,"source":"pdf_text","source_observed_at":"2026-08-06T15:56:57.075014Z"},"links":{"citing_paper":"/paper/2507.14748"},"observation_digest":"sha256:6c9d75c3b3f21d2d8af2b720487a6cb4b2e5b83438bf3b9d63f02ce2a1247368","observation_id":"4deb8c43-fc2a-453f-9a9a-e598cf53c61d","resolution":{"observed_at":"2026-08-06T15:57:05.023836Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T15:57:05.001746Z","title":"Lipschitz- constrained unsupervised skill discovery","venue":null,"work_id":"ede533b9-223f-41e5-a749-6b193f3efed1","year":2022},"citing_paper":{"arxiv_id":"2507.14748","last_updated":"2025-07-19T20:48:46Z","snapshot_observed_at":"2026-08-15T18:16:12.405822Z","submitted_at":"2025-07-19T20:48:46Z","title":"Skill Learning via Policy Diversity Yields Identifiable Representations for Reinforcement Learning","version":1},"reference_index":40,"source":"pdf_text","source_observed_at":"2026-08-06T15:56:57.154405Z"},"links":{"citing_paper":"/paper/2507.14748"},"observation_digest":"sha256:dc455a843029bbd8fc3d989d3a53093e55766fa30373a4eed81c4cf02b9f3001","observation_id":"f3881480-8ece-4640-baac-4cad6756b01f","resolution":{"observed_at":"2026-08-06T15:57:05.007209Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2406.01506","last_updated":"2025-02-18T02:23:45Z","snapshot_observed_at":"2026-08-17T00:18:50.876112Z","submitted_at":"2024-06-03T16:34:01Z","title":"The Geometry of Categorical and Hierarchical Concepts in Large Language Models","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2406.01506","snapshot_observed_at":"2026-08-06T15:56:57.016599Z","title":"The Geometry of Categorical and Hierarchical Concepts in Large Language Models, June 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.14748","last_updated":"2025-07-19T20:48:46Z","snapshot_observed_at":"2026-08-15T18:16:12.405822Z","submitted_at":"2025-07-19T20:48:46Z","title":"Skill Learning via Policy Diversity Yields Identifiable Representations for Reinforcement Learning","version":1},"reference_index":41,"source":"pdf_text","source_observed_at":"2026-08-06T15:56:57.016599Z"},"links":{"cited_paper":"/paper/2406.01506","citing_paper":"/paper/2507.14748"},"observation_digest":"sha256:9baae7baf9ddbe7a9e21e55d88e72749daf067daa857965f449a9a2d8f01c42e","observation_id":"cea19832-a4f6-40ff-95cc-529f1731985d","resolution":{"observed_at":"2026-08-06T15:56:57.016599Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2310.08887","last_updated":"2024-03-10T04:30:17Z","snapshot_observed_at":"2026-08-18T16:28:23.423112Z","submitted_at":"2023-10-13T06:43:11Z","title":"METRA: Scalable Unsupervised RL with Metric-Aware Abstraction","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2310.08887","snapshot_observed_at":"2026-08-06T15:56:57.311531Z","title":"METRA: Scalable Unsupervised RL with Metric-Aware Abstraction, March 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.14748","last_updated":"2025-07-19T20:48:46Z","snapshot_observed_at":"2026-08-15T18:16:12.405822Z","submitted_at":"2025-07-19T20:48:46Z","title":"Skill Learning via Policy Diversity Yields Identifiable Representations for Reinforcement Learning","version":1},"reference_index":42,"source":"pdf_text","source_observed_at":"2026-08-06T15:56:57.311531Z"},"links":{"cited_paper":"/paper/2310.08887","citing_paper":"/paper/2507.14748"},"observation_digest":"sha256:d4db4f626046ecc3bd48281c7885a5fe38eb20d62c3e1ca4026cf596b2b6b832","observation_id":"9d030a42-b5d0-458d-be0b-23a1588a26c5","resolution":{"observed_at":"2026-08-06T15:56:57.311531Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2104.06612","last_updated":"2021-04-14T03:38:32Z","snapshot_observed_at":"2026-08-16T18:31:46.472613Z","submitted_at":"2021-04-14T03:38:32Z","title":"Deep Data Density Estimation through Donsker-Varadhan Representation","version":1},"cited_work":{"arxiv_id":"2104.06612","doi":null,"metadata_source":"pith","pith_arxiv_id":"2104.06612","snapshot_observed_at":"2026-08-06T15:57:02.608956Z","title":"Deep Data Density Estimation through Donsker-Varadhan Representation","venue":"cs.LG","work_id":"a1f80cb5-1fc0-4700-a611-d40825fb7fe6","year":2021},"citing_paper":{"arxiv_id":"2507.14748","last_updated":"2025-07-19T20:48:46Z","snapshot_observed_at":"2026-08-15T18:16:12.405822Z","submitted_at":"2025-07-19T20:48:46Z","title":"Skill Learning via Policy Diversity Yields Identifiable Representations for Reinforcement Learning","version":1},"reference_index":43,"source":"pdf_text","source_observed_at":"2026-08-06T15:56:57.413895Z"},"links":{"cited_paper":"/paper/2104.06612","citing_paper":"/paper/2507.14748"},"observation_digest":"sha256:1d5f4c17b75a9526cede4f13cb2a0f282d8f79e4f98fcee4b6f1b1626119415f","observation_id":"b6c42f25-9c6b-4daa-9f49-35884287df9e","resolution":{"observed_at":"2026-08-06T15:57:02.675626Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2302.05103","last_updated":"2023-06-03T23:35:22Z","snapshot_observed_at":"2026-08-16T15:56:19.622315Z","submitted_at":"2023-02-10T08:03:09Z","title":"Controllability-Aware Unsupervised Skill Discovery","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2302.05103","snapshot_observed_at":"2026-08-06T15:56:57.250665Z","title":"Controllability-Aware Unsupervised Skill Discovery, June 2023","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2507.14748","last_updated":"2025-07-19T20:48:46Z","snapshot_observed_at":"2026-08-15T18:16:12.405822Z","submitted_at":"2025-07-19T20:48:46Z","title":"Skill Learning via Policy Diversity Yields Identifiable Representations for Reinforcement Learning","version":1},"reference_index":44,"source":"pdf_text","source_observed_at":"2026-08-06T15:56:57.250665Z"},"links":{"cited_paper":"/paper/2302.05103","citing_paper":"/paper/2507.14748"},"observation_digest":"sha256:f6dcee76f96a6ec2b92ece765e7f038849203148e06774931addda8c441c191f","observation_id":"002d4c57-3123-40c7-804b-66561d9caf76","resolution":{"observed_at":"2026-08-06T15:56:57.250665Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"document/8014804","doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T15:57:02.446728Z","title":"Efros, and Trevor Darrell","venue":null,"work_id":"b2b85f4b-4fa8-4769-98b2-99d2551a6a7e","year":2017},"citing_paper":{"arxiv_id":"2507.14748","last_updated":"2025-07-19T20:48:46Z","snapshot_observed_at":"2026-08-15T18:16:12.405822Z","submitted_at":"2025-07-19T20:48:46Z","title":"Skill Learning via Policy Diversity Yields Identifiable Representations for Reinforcement Learning","version":1},"reference_index":45,"source":"pdf_text","source_observed_at":"2026-08-06T15:56:57.707731Z"},"links":{"citing_paper":"/paper/2507.14748"},"observation_digest":"sha256:a25f645fad0c8c9cb812dc75ac6493cfbb0c63e4858e7c918c13bf4a8b4444c3","observation_id":"7889167e-f311-4c3f-ae02-55e3da34aa74","resolution":{"observed_at":"2026-08-06T15:57:02.506408Z","resolver_source":"raw_fallback","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T15:56:57.854646Z","title":"Causality: Models, Reasoning, and Inference","venue":null,"work_id":null,"year":2009},"citing_paper":{"arxiv_id":"2507.14748","last_updated":"2025-07-19T20:48:46Z","snapshot_observed_at":"2026-08-15T18:16:12.405822Z","submitted_at":"2025-07-19T20:48:46Z","title":"Skill Learning via Policy Diversity Yields Identifiable Representations for Reinforcement Learning","version":1},"reference_index":46,"source":"pdf_text","source_observed_at":"2026-08-06T15:56:57.854646Z"},"links":{"citing_paper":"/paper/2507.14748"},"observation_digest":"sha256:53b27bdb4e14fc23b23cf7cc3fb5eb5146a6ad18db2d425ae6e80f3a500be6fe","observation_id":"d32a5ecd-f6c4-4da6-9d82-8f1fdc0976f2","resolution":{"observed_at":"2026-08-06T15:56:57.854646Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T15:57:04.984349Z","title":"Self-Supervised Exploration via Disagree- ment","venue":null,"work_id":"001a1ac3-bb33-4df3-af12-c2ba270b2b95","year":null},"citing_paper":{"arxiv_id":"2507.14748","last_updated":"2025-07-19T20:48:46Z","snapshot_observed_at":"2026-08-15T18:16:12.405822Z","submitted_at":"2025-07-19T20:48:46Z","title":"Skill Learning via Policy Diversity Yields Identifiable Representations for Reinforcement Learning","version":1},"reference_index":47,"source":"pdf_text","source_observed_at":"2026-08-06T15:56:57.507930Z"},"links":{"citing_paper":"/paper/2507.14748"},"observation_digest":"sha256:a8381a09e5940a4340ab05d15ac5b213769930ad07eb85d6a4de53aa57216a3c","observation_id":"b0d8f9e2-b019-46f3-94cd-d354a03f6d27","resolution":{"observed_at":"2026-08-06T15:57:04.990019Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T15:57:04.967879Z","title":"Jacobian-based Causal Discovery with Nonlinear ICA","venue":null,"work_id":"f8960564-88a1-43e6-90fb-f93af80d679b","year":2023},"citing_paper":{"arxiv_id":"2507.14748","last_updated":"2025-07-19T20:48:46Z","snapshot_observed_at":"2026-08-15T18:16:12.405822Z","submitted_at":"2025-07-19T20:48:46Z","title":"Skill Learning via Policy Diversity Yields Identifiable Representations for Reinforcement Learning","version":1},"reference_index":48,"source":"pdf_text","source_observed_at":"2026-08-06T15:56:58.104276Z"},"links":{"citing_paper":"/paper/2507.14748"},"observation_digest":"sha256:17898c9b7f657830f777c12c69306d6e239b3f0d48455e1f2ca3a9c9efd7057a","observation_id":"34c3d0fd-f132-4873-8515-adda5a65e253","resolution":{"observed_at":"2026-08-06T15:57:04.972418Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T15:57:04.952073Z","title":"V ogt, Randall Balestriero, Wieland Brendel, and David Klindt","venue":null,"work_id":"99752bc0-15bb-4cdf-9f71-9177034babd2","year":2024},"citing_paper":{"arxiv_id":"2507.14748","last_updated":"2025-07-19T20:48:46Z","snapshot_observed_at":"2026-08-15T18:16:12.405822Z","submitted_at":"2025-07-19T20:48:46Z","title":"Skill Learning via Policy Diversity Yields Identifiable Representations for Reinforcement Learning","version":1},"reference_index":49,"source":"pdf_text","source_observed_at":"2026-08-06T15:56:58.252833Z"},"links":{"citing_paper":"/paper/2507.14748"},"observation_digest":"sha256:3357b0107e9e44dbcbe3f2dd8d70bf2fe9c6a069e4a8e52fce5e34b73c9bcf5f","observation_id":"050c96f2-bd51-4f64-8a1e-5ca627c8d07a","resolution":{"observed_at":"2026-08-06T15:57:04.957012Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2311.18048","last_updated":"2024-02-16T10:36:55Z","snapshot_observed_at":"2026-08-18T22:21:10.606652Z","submitted_at":"2023-11-29T19:51:35Z","title":"An Interventional Perspective on Identifiability in Gaussian LTI Systems with Independent Component Analysis","version":2},"cited_work":{"arxiv_id":"2311.18048","doi":null,"metadata_source":"pith","pith_arxiv_id":"2311.18048","snapshot_observed_at":"2026-08-06T15:57:02.136477Z","title":"An Interventional Perspective on Identifiability in Gaussian LTI Systems with Independent Component Analysis","venue":"cs.LG","work_id":"7d3c567d-7736-42d3-b2da-20279a6b61e3","year":2023},"citing_paper":{"arxiv_id":"2507.14748","last_updated":"2025-07-19T20:48:46Z","snapshot_observed_at":"2026-08-15T18:16:12.405822Z","submitted_at":"2025-07-19T20:48:46Z","title":"Skill Learning via Policy Diversity Yields Identifiable Representations for Reinforcement Learning","version":1},"reference_index":50,"source":"pdf_text","source_observed_at":"2026-08-06T15:56:58.000047Z"},"links":{"cited_paper":"/paper/2311.18048","citing_paper":"/paper/2507.14748"},"observation_digest":"sha256:43dd8aad08a13b56ffde136e8bae0a64ac89883b56676e7477901b1835fec8ec","observation_id":"fbd60e6a-42cc-478e-a5d0-595a545366dc","resolution":{"observed_at":"2026-08-06T15:57:02.252791Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2007.00810","last_updated":"2020-07-08T03:51:28Z","snapshot_observed_at":"2026-08-09T00:43:33.824393Z","submitted_at":"2020-07-01T23:33:37Z","title":"On Linear Identifiability of Learned Representations","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2007.00810","snapshot_observed_at":"2026-08-06T15:56:58.462920Z","title":null,"venue":null,"work_id":null,"year":2007},"citing_paper":{"arxiv_id":"2507.14748","last_updated":"2025-07-19T20:48:46Z","snapshot_observed_at":"2026-08-15T18:16:12.405822Z","submitted_at":"2025-07-19T20:48:46Z","title":"Skill Learning via Policy Diversity Yields Identifiable Representations for Reinforcement Learning","version":1},"reference_index":51,"source":"pdf_text","source_observed_at":"2026-08-06T15:56:58.462920Z"},"links":{"cited_paper":"/paper/2007.00810","citing_paper":"/paper/2507.14748"},"observation_digest":"sha256:64922701d36654f8858a3ee108eabbf93764031818a108afaa6c0fc03362fd46","observation_id":"a9f6024d-09bb-4c0d-8423-3861efb61d73","resolution":{"observed_at":"2026-08-06T15:56:58.462920Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2407.00143","last_updated":"2025-04-16T15:26:14Z","snapshot_observed_at":"2026-08-16T15:56:17.149513Z","submitted_at":"2024-06-28T16:08:26Z","title":"InfoNCE: Identifying the Gap Between Theory and Practice","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2407.00143","snapshot_observed_at":"2026-08-06T15:56:58.625898Z","title":"Zimmermann, and Wieland Brendel","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.14748","last_updated":"2025-07-19T20:48:46Z","snapshot_observed_at":"2026-08-15T18:16:12.405822Z","submitted_at":"2025-07-19T20:48:46Z","title":"Skill Learning via Policy Diversity Yields Identifiable Representations for Reinforcement Learning","version":1},"reference_index":52,"source":"pdf_text","source_observed_at":"2026-08-06T15:56:58.625898Z"},"links":{"cited_paper":"/paper/2407.00143","citing_paper":"/paper/2507.14748"},"observation_digest":"sha256:b217cde43a31c36d56fb8598111be999296fad7a6f1d6e3a825857aeb4da5d98","observation_id":"3700c629-12f8-4c88-a252-45a5e2d64fdc","resolution":{"observed_at":"2026-08-06T15:56:58.625898Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T15:57:04.935504Z","title":"Identifiable Exchangeable Mechanisms for Causal Structure and Representation Learning","venue":null,"work_id":"b9181abc-5b1d-462c-b97a-9f6c57f357ca","year":2024},"citing_paper":{"arxiv_id":"2507.14748","last_updated":"2025-07-19T20:48:46Z","snapshot_observed_at":"2026-08-15T18:16:12.405822Z","submitted_at":"2025-07-19T20:48:46Z","title":"Skill Learning via Policy Diversity Yields Identifiable Representations for Reinforcement Learning","version":1},"reference_index":53,"source":"pdf_text","source_observed_at":"2026-08-06T15:56:58.357193Z"},"links":{"citing_paper":"/paper/2507.14748"},"observation_digest":"sha256:8e624868999c544c5d41cdc77476995472c77d3d40eede944b49259b05e746a8","observation_id":"54a8feed-b7f9-4438-b8ec-9d71a3205b24","resolution":{"observed_at":"2026-08-06T15:57:04.940702Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2102.11107","last_updated":"2021-02-22T15:26:57Z","snapshot_observed_at":"2026-08-16T18:43:53.864885Z","submitted_at":"2021-02-22T15:26:57Z","title":"Towards Causal Representation Learning","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2102.11107","snapshot_observed_at":"2026-08-06T15:56:58.831755Z","title":"Towards Causal Representation Learning","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2507.14748","last_updated":"2025-07-19T20:48:46Z","snapshot_observed_at":"2026-08-15T18:16:12.405822Z","submitted_at":"2025-07-19T20:48:46Z","title":"Skill Learning via Policy Diversity Yields Identifiable Representations for Reinforcement Learning","version":1},"reference_index":54,"source":"pdf_text","source_observed_at":"2026-08-06T15:56:58.831755Z"},"links":{"cited_paper":"/paper/2102.11107","citing_paper":"/paper/2507.14748"},"observation_digest":"sha256:8eba11a7a85d98551a13a859fc6b9a72578065b7d8dd72322cdb4d446831c5be","observation_id":"d986c1ed-d72c-47a8-ab54-03e8595e116d","resolution":{"observed_at":"2026-08-06T15:56:58.831755Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2005.05960","last_updated":"2020-06-30T23:05:50Z","snapshot_observed_at":"2026-08-19T18:09:18.970499Z","submitted_at":"2020-05-12T17:59:45Z","title":"Planning to Explore via Self-Supervised World Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2005.05960","snapshot_observed_at":"2026-08-06T15:56:58.996781Z","title":"Planning to Explore via Self-Supervised World Models","venue":null,"work_id":null,"year":2005},"citing_paper":{"arxiv_id":"2507.14748","last_updated":"2025-07-19T20:48:46Z","snapshot_observed_at":"2026-08-15T18:16:12.405822Z","submitted_at":"2025-07-19T20:48:46Z","title":"Skill Learning via Policy Diversity Yields Identifiable Representations for Reinforcement Learning","version":1},"reference_index":55,"source":"pdf_text","source_observed_at":"2026-08-06T15:56:58.996781Z"},"links":{"cited_paper":"/paper/2005.05960","citing_paper":"/paper/2507.14748"},"observation_digest":"sha256:349c78affdb14cdfb3ae6cdb559031d395ae2139821daae84351f73805c2423d","observation_id":"773662f9-d94a-4473-a5f5-3550ec1c59ea","resolution":{"observed_at":"2026-08-06T15:56:58.996781Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T15:57:04.917364Z","title":"Regularity as Intrinsic Reward for Free Play","venue":null,"work_id":"d7899065-ede0-4dc2-a7c0-dc861f042911","year":2023},"citing_paper":{"arxiv_id":"2507.14748","last_updated":"2025-07-19T20:48:46Z","snapshot_observed_at":"2026-08-15T18:16:12.405822Z","submitted_at":"2025-07-19T20:48:46Z","title":"Skill Learning via Policy Diversity Yields Identifiable Representations for Reinforcement Learning","version":1},"reference_index":56,"source":"pdf_text","source_observed_at":"2026-08-06T15:56:58.727385Z"},"links":{"citing_paper":"/paper/2507.14748"},"observation_digest":"sha256:bcf9489c8f0222728147c4a0cbeaabf2493801344e10ee9e1acf174d3226ba6d","observation_id":"f4c12374-054a-4030-9a5f-cf691627fd94","resolution":{"observed_at":"2026-08-06T15:57:04.923425Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2207.10081","last_updated":"2022-07-20T04:44:26Z","snapshot_observed_at":"2026-08-17T20:53:06.587891Z","submitted_at":"2022-07-20T04:44:26Z","title":"What Do We Maximize in Self-Supervised Learning?","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2207.10081","snapshot_observed_at":"2026-08-06T15:56:59.202089Z","title":"What Do We Maximize in Self-Supervised Learning?, July 2022","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2507.14748","last_updated":"2025-07-19T20:48:46Z","snapshot_observed_at":"2026-08-15T18:16:12.405822Z","submitted_at":"2025-07-19T20:48:46Z","title":"Skill Learning via Policy Diversity Yields Identifiable Representations for Reinforcement Learning","version":1},"reference_index":57,"source":"pdf_text","source_observed_at":"2026-08-06T15:56:59.202089Z"},"links":{"cited_paper":"/paper/2207.10081","citing_paper":"/paper/2507.14748"},"observation_digest":"sha256:24c71ef606f13d0ae37eb2e00b657bee96ce6bafc71836df4f5a37abc7528a35","observation_id":"b9fa943e-ddb7-497a-812a-13bf5d882391","resolution":{"observed_at":"2026-08-06T15:56:59.202089Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T15:57:04.902648Z","title":"MIT press, 2000","venue":null,"work_id":"c3d6b53d-d196-4f83-8008-f43275159151","year":2000},"citing_paper":{"arxiv_id":"2507.14748","last_updated":"2025-07-19T20:48:46Z","snapshot_observed_at":"2026-08-15T18:16:12.405822Z","submitted_at":"2025-07-19T20:48:46Z","title":"Skill Learning via Policy Diversity Yields Identifiable Representations for Reinforcement Learning","version":1},"reference_index":58,"source":"pdf_text","source_observed_at":"2026-08-06T15:56:59.344907Z"},"links":{"citing_paper":"/paper/2507.14748"},"observation_digest":"sha256:00e44764334cb68c196c233487d6d44bda16f0565330553f228b8734dc1279b9","observation_id":"ee2c44dd-6d89-4da9-b1bc-eb8761488c4e","resolution":{"observed_at":"2026-08-06T15:57:04.907280Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1907.01657","last_updated":"2020-02-14T23:20:43Z","snapshot_observed_at":"2026-08-20T12:22:15.069177Z","submitted_at":"2019-07-02T21:32:19Z","title":"Dynamics-Aware Unsupervised Discovery of Skills","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1907.01657","snapshot_observed_at":"2026-08-06T15:56:59.109038Z","title":"Dynamics- Aware Unsupervised Discovery of Skills, February 2020","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2507.14748","last_updated":"2025-07-19T20:48:46Z","snapshot_observed_at":"2026-08-15T18:16:12.405822Z","submitted_at":"2025-07-19T20:48:46Z","title":"Skill Learning via Policy Diversity Yields Identifiable Representations for Reinforcement Learning","version":1},"reference_index":59,"source":"pdf_text","source_observed_at":"2026-08-06T15:56:59.109038Z"},"links":{"cited_paper":"/paper/1907.01657","citing_paper":"/paper/2507.14748"},"observation_digest":"sha256:ed38e430efc1b6ce2e7ff4c02181d05ad249c770afbcfb8e529e08222dbcc0bf","observation_id":"15e5ecc8-53f5-4941-bf8a-32a8a5e781e0","resolution":{"observed_at":"2026-08-06T15:56:59.109038Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T15:57:04.847321Z","title":"Optimistic Active Exploration of Dynamical Systems","venue":null,"work_id":"95556f1f-53ce-4a0b-bd87-becaeda67748","year":2023},"citing_paper":{"arxiv_id":"2507.14748","last_updated":"2025-07-19T20:48:46Z","snapshot_observed_at":"2026-08-15T18:16:12.405822Z","submitted_at":"2025-07-19T20:48:46Z","title":"Skill Learning via Policy Diversity Yields Identifiable Representations for Reinforcement Learning","version":1},"reference_index":60,"source":"pdf_text","source_observed_at":"2026-08-06T15:56:59.556559Z"},"links":{"citing_paper":"/paper/2507.14748"},"observation_digest":"sha256:734fa468a539470ad077579941ab2de237c855ce7d89971d6416b86caf36d132","observation_id":"f16ee830-f988-4ec0-a73b-9bbb4b1cbcc6","resolution":{"observed_at":"2026-08-06T15:57:04.874463Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1907.13625","last_updated":"2020-01-23T09:08:54Z","snapshot_observed_at":"2026-08-21T18:51:14.614972Z","submitted_at":"2019-07-31T17:50:51Z","title":"On Mutual Information Maximization for Representation Learning","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1907.13625","snapshot_observed_at":"2026-08-06T15:56:59.660079Z","title":"Rubenstein, Sylvain Gelly, and Mario Lucic","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2507.14748","last_updated":"2025-07-19T20:48:46Z","snapshot_observed_at":"2026-08-15T18:16:12.405822Z","submitted_at":"2025-07-19T20:48:46Z","title":"Skill Learning via Policy Diversity Yields Identifiable Representations for Reinforcement Learning","version":1},"reference_index":61,"source":"pdf_text","source_observed_at":"2026-08-06T15:56:59.660079Z"},"links":{"cited_paper":"/paper/1907.13625","citing_paper":"/paper/2507.14748"},"observation_digest":"sha256:1df56dab351c24242d2d0ea0ce7c3776c52bc2d7c87592966676276d421a87c8","observation_id":"d7950e97-1992-4efa-bc1d-14d61aa1d00d","resolution":{"observed_at":"2026-08-06T15:56:59.660079Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T15:57:04.886443Z","title":"Reinforcement learning: An introduction, volume 1","venue":null,"work_id":"c4bd6167-c3a4-4a11-b8cb-9e49dec258d0","year":1998},"citing_paper":{"arxiv_id":"2507.14748","last_updated":"2025-07-19T20:48:46Z","snapshot_observed_at":"2026-08-15T18:16:12.405822Z","submitted_at":"2025-07-19T20:48:46Z","title":"Skill Learning via Policy Diversity Yields Identifiable Representations for Reinforcement Learning","version":1},"reference_index":62,"source":"pdf_text","source_observed_at":"2026-08-06T15:56:59.453878Z"},"links":{"citing_paper":"/paper/2507.14748"},"observation_digest":"sha256:92070255ec464b4e932cd6c998187a224e4e0d6f673327046e61ca81d96d95d8","observation_id":"d2d02a1c-c386-4181-8e63-7c2cfe6fbf99","resolution":{"observed_at":"2026-08-06T15:57:04.891616Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2203.13457","last_updated":"2022-05-27T09:29:45Z","snapshot_observed_at":"2026-08-16T17:11:54.751289Z","submitted_at":"2022-03-25T05:36:26Z","title":"Chaos is a Ladder: A New Theoretical Understanding of Contrastive Learning via Augmentation Overlap","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2203.13457","snapshot_observed_at":"2026-08-06T15:57:00.050531Z","title":"Chaos is a Ladder: A New Theoretical Understanding of Contrastive Learning via Augmentation Overlap, May 2022","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2507.14748","last_updated":"2025-07-19T20:48:46Z","snapshot_observed_at":"2026-08-15T18:16:12.405822Z","submitted_at":"2025-07-19T20:48:46Z","title":"Skill Learning via Policy Diversity Yields Identifiable Representations for Reinforcement Learning","version":1},"reference_index":63,"source":"pdf_text","source_observed_at":"2026-08-06T15:57:00.050531Z"},"links":{"cited_paper":"/paper/2203.13457","citing_paper":"/paper/2507.14748"},"observation_digest":"sha256:2d90cbe30175bb81366718f21281812601d02938b58d59d0a5486e7472529d89","observation_id":"af25d6eb-d14d-400a-adb3-42aaf21ee20b","resolution":{"observed_at":"2026-08-06T15:57:00.050531Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1811.11359","last_updated":"2018-11-28T02:35:24Z","snapshot_observed_at":"2026-08-18T21:44:05.183198Z","submitted_at":"2018-11-28T02:35:24Z","title":"Unsupervised Control Through Non-Parametric Discriminative Rewards","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1811.11359","snapshot_observed_at":"2026-08-06T15:57:00.190972Z","title":"Unsupervised control through non-parametric discriminative rewards.arXiv preprint arXiv:1811.11359, 2018","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2507.14748","last_updated":"2025-07-19T20:48:46Z","snapshot_observed_at":"2026-08-15T18:16:12.405822Z","submitted_at":"2025-07-19T20:48:46Z","title":"Skill Learning via Policy Diversity Yields Identifiable Representations for Reinforcement Learning","version":1},"reference_index":64,"source":"pdf_text","source_observed_at":"2026-08-06T15:57:00.190972Z"},"links":{"cited_paper":"/paper/1811.11359","citing_paper":"/paper/2507.14748"},"observation_digest":"sha256:20c98b1f24e8165c845010993a81021c0ac4d4877ea4afa0d500f497c0fbab4d","observation_id":"e56d1e4a-8ee7-4ce1-8856-64ea6bdfbf18","resolution":{"observed_at":"2026-08-06T15:57:00.190972Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2005.10242","last_updated":"2022-08-15T22:04:26Z","snapshot_observed_at":"2026-08-09T00:01:11.785313Z","submitted_at":"2020-05-20T17:59:57Z","title":"Understanding Contrastive Representation Learning through Alignment and Uniformity on the Hypersphere","version":10},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2005.10242","snapshot_observed_at":"2026-08-06T15:56:59.769844Z","title":"Understanding Contrastive Representation Learning through Alignment and Uniformity on the Hypersphere","venue":null,"work_id":null,"year":2005},"citing_paper":{"arxiv_id":"2507.14748","last_updated":"2025-07-19T20:48:46Z","snapshot_observed_at":"2026-08-15T18:16:12.405822Z","submitted_at":"2025-07-19T20:48:46Z","title":"Skill Learning via Policy Diversity Yields Identifiable Representations for Reinforcement Learning","version":1},"reference_index":65,"source":"pdf_text","source_observed_at":"2026-08-06T15:56:59.769844Z"},"links":{"cited_paper":"/paper/2005.10242","citing_paper":"/paper/2507.14748"},"observation_digest":"sha256:36b1a08904859d985bac9f0d3eb08a4b0886e650b6bd6da7309e60278362229c","observation_id":"bc08240c-f58a-4be5-b86e-1442546b8d65","resolution":{"observed_at":"2026-08-06T15:56:59.769844Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T15:57:04.681904Z","title":"Correlation and causation","venue":null,"work_id":"8d094a7e-207a-41f0-b52d-84a7ffd56c1e","year":1921},"citing_paper":{"arxiv_id":"2507.14748","last_updated":"2025-07-19T20:48:46Z","snapshot_observed_at":"2026-08-15T18:16:12.405822Z","submitted_at":"2025-07-19T20:48:46Z","title":"Skill Learning via Policy Diversity Yields Identifiable Representations for Reinforcement Learning","version":1},"reference_index":66,"source":"pdf_text","source_observed_at":"2026-08-06T15:57:00.502004Z"},"links":{"citing_paper":"/paper/2507.14748"},"observation_digest":"sha256:28f0507b6009f6cb00611fbd5762cf7fbd55c623567bd08136c34d859fdd3e27","observation_id":"6b7b1f8a-9e23-4ea9-9433-b83566332c68","resolution":{"observed_at":"2026-08-06T15:57:04.781340Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T15:57:04.533570Z","title":"Yu, and Dahua Lin","venue":null,"work_id":"c972abe1-bd75-47f0-a421-034825a485fd","year":2018},"citing_paper":{"arxiv_id":"2507.14748","last_updated":"2025-07-19T20:48:46Z","snapshot_observed_at":"2026-08-15T18:16:12.405822Z","submitted_at":"2025-07-19T20:48:46Z","title":"Skill Learning via Policy Diversity Yields Identifiable Representations for Reinforcement Learning","version":1},"reference_index":67,"source":"pdf_text","source_observed_at":"2026-08-06T15:57:00.672775Z"},"links":{"citing_paper":"/paper/2507.14748"},"observation_digest":"sha256:cc8ba14458e0f160ecdc3a9b0a5707966389b387c34c64fc2fab260709229174","observation_id":"a32cba91-6d98-48c2-aa65-d3a653bb4ab5","resolution":{"observed_at":"2026-08-06T15:57:04.653934Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2305.17225","last_updated":"2024-01-17T14:22:19Z","snapshot_observed_at":"2026-08-20T00:00:11.283311Z","submitted_at":"2023-05-26T19:34:35Z","title":"Causal Component Analysis","version":3},"cited_work":{"arxiv_id":"2305.17225","doi":null,"metadata_source":"pith","pith_arxiv_id":"2305.17225","snapshot_observed_at":"2026-08-06T15:57:01.798541Z","title":"Causal Component Analysis","venue":"stat.ML","work_id":"b2f5e7f6-fe89-43e4-85ee-68cc13eb24b9","year":2023},"citing_paper":{"arxiv_id":"2507.14748","last_updated":"2025-07-19T20:48:46Z","snapshot_observed_at":"2026-08-15T18:16:12.405822Z","submitted_at":"2025-07-19T20:48:46Z","title":"Skill Learning via Policy Diversity Yields Identifiable Representations for Reinforcement Learning","version":1},"reference_index":68,"source":"pdf_text","source_observed_at":"2026-08-06T15:57:00.364400Z"},"links":{"cited_paper":"/paper/2305.17225","citing_paper":"/paper/2507.14748"},"observation_digest":"sha256:f34ed29e7574bc1476dea50a9eb46cbd8181bd31a484966cb04f26867ab3ab10","observation_id":"4ff0d31b-df22-466d-8638-e0b651db5a16","resolution":{"observed_at":"2026-08-06T15:57:01.842388Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2506.10629","last_updated":"2025-06-12T12:13:58Z","snapshot_observed_at":"2026-08-09T14:58:05.115378Z","submitted_at":"2025-06-12T12:13:58Z","title":"Task Adaptation from Skills: Information Geometry, Disentanglement, and New Objectives for Unsupervised Reinforcement Learning","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2506.10629","snapshot_observed_at":"2026-08-06T15:57:00.816877Z","title":"Task Adaptation from Skills: Information Geometry, Disentanglement, and New Objectives for Unsupervised Reinforcement Learning, June 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2507.14748","last_updated":"2025-07-19T20:48:46Z","snapshot_observed_at":"2026-08-15T18:16:12.405822Z","submitted_at":"2025-07-19T20:48:46Z","title":"Skill Learning via Policy Diversity Yields Identifiable Representations for Reinforcement Learning","version":1},"reference_index":69,"source":"pdf_text","source_observed_at":"2026-08-06T15:57:00.816877Z"},"links":{"cited_paper":"/paper/2506.10629","citing_paper":"/paper/2507.14748"},"observation_digest":"sha256:1d6b74cf84c74c2e037e4da47bb66b93be40da7bbaed01ee1f3838b22643c947","observation_id":"daaa26ea-fe07-4cce-9e16-de7d81188b90","resolution":{"observed_at":"2026-08-06T15:57:00.816877Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T15:57:00.920777Z","title":"Contrastive Difference Predic- tive Coding, October 2023","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2507.14748","last_updated":"2025-07-19T20:48:46Z","snapshot_observed_at":"2026-08-15T18:16:12.405822Z","submitted_at":"2025-07-19T20:48:46Z","title":"Skill Learning via Policy Diversity Yields Identifiable Representations for Reinforcement Learning","version":1},"reference_index":70,"source":"pdf_text","source_observed_at":"2026-08-06T15:57:00.920777Z"},"links":{"citing_paper":"/paper/2507.14748"},"observation_digest":"sha256:754743e84445e059ab710d5d0b5bd7fdac793fd4645b8c345d60a6108388d8e0","observation_id":"1e6c322a-fde6-44ba-baa5-8871bd66e296","resolution":{"observed_at":"2026-08-06T15:57:00.920777Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2004.08697","last_updated":"2023-12-19T03:58:16Z","snapshot_observed_at":"2026-08-08T23:37:44.792748Z","submitted_at":"2020-04-18T20:09:34Z","title":"CausalVAE: Structured Causal Disentanglement in Variational Autoencoder","version":7},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2004.08697","snapshot_observed_at":"2026-08-06T15:57:00.750436Z","title":"CausalV AE: Structured Causal Disentanglement in Variational Autoencoder, December 2023","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2507.14748","last_updated":"2025-07-19T20:48:46Z","snapshot_observed_at":"2026-08-15T18:16:12.405822Z","submitted_at":"2025-07-19T20:48:46Z","title":"Skill Learning via Policy Diversity Yields Identifiable Representations for Reinforcement Learning","version":1},"reference_index":71,"source":"pdf_text","source_observed_at":"2026-08-06T15:57:00.750436Z"},"links":{"cited_paper":"/paper/2004.08697","citing_paper":"/paper/2507.14748"},"observation_digest":"sha256:d3d60168b034adbd908702a8acf9d73af9346f469a21e7cdfae0234135ff3727","observation_id":"701e759f-cfc7-4e36-b8be-53e878600311","resolution":{"observed_at":"2026-08-06T15:57:00.750436Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2102.08850","last_updated":"2022-04-07T07:40:49Z","snapshot_observed_at":"2026-08-16T18:44:55.156891Z","submitted_at":"2021-02-17T16:21:54Z","title":"Contrastive Learning Inverts the Data Generating Process","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2102.08850","snapshot_observed_at":"2026-08-06T15:57:01.142181Z","title":"Zimmermann, Yash Sharma, Steffen Schneider, Matthias Bethge, and Wieland Brendel","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2507.14748","last_updated":"2025-07-19T20:48:46Z","snapshot_observed_at":"2026-08-15T18:16:12.405822Z","submitted_at":"2025-07-19T20:48:46Z","title":"Skill Learning via Policy Diversity Yields Identifiable Representations for Reinforcement Learning","version":1},"reference_index":72,"source":"pdf_text","source_observed_at":"2026-08-06T15:57:01.142181Z"},"links":{"cited_paper":"/paper/2102.08850","citing_paper":"/paper/2507.14748"},"observation_digest":"sha256:4a1969fe9d915369a8d7cd4891b335fe73002e9eee66f1e657ad938f4f9e0da7","observation_id":"7679494a-75b4-4c30-a4fd-57d359728ddc","resolution":{"observed_at":"2026-08-06T15:57:01.142181Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T15:57:01.022480Z","title":"Can a MISL Fly? Analysis and Ingredients for Mutual Information Skill Learning, December 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.14748","last_updated":"2025-07-19T20:48:46Z","snapshot_observed_at":"2026-08-15T18:16:12.405822Z","submitted_at":"2025-07-19T20:48:46Z","title":"Skill Learning via Policy Diversity Yields Identifiable Representations for Reinforcement Learning","version":1},"reference_index":74,"source":"pdf_text","source_observed_at":"2026-08-06T15:57:01.022480Z"},"links":{"citing_paper":"/paper/2507.14748"},"observation_digest":"sha256:29ddf112a68120f542c194fe67d180a935a1628532c55c673f2bb4794b9f35cd","observation_id":"3391fa63-217f-4ed8-aef6-9ed495a63c7e","resolution":{"observed_at":"2026-08-06T15:57:01.022480Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T15:57:04.375648Z","title":null,"venue":null,"work_id":"0a2ba073-087d-46d5-8606-b82885d6ea8d","year":null},"citing_paper":{"arxiv_id":"2507.14748","last_updated":"2025-07-19T20:48:46Z","snapshot_observed_at":"2026-08-15T18:16:12.405822Z","submitted_at":"2025-07-19T20:48:46Z","title":"Skill Learning via Policy Diversity Yields Identifiable Representations for Reinforcement Learning","version":1},"reference_index":76,"source":"pdf_text","source_observed_at":"2026-08-06T15:57:01.329426Z"},"links":{"citing_paper":"/paper/2507.14748"},"observation_digest":"sha256:304cb49a514cbcaaf868a37eb67c17886579c1a6908920e6b37a9054035d19ca","observation_id":"7eec6e22-f821-4523-8df3-69ace8064fd4","resolution":{"observed_at":"2026-08-06T15:57:04.469936Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T15:57:04.216096Z","title":null,"venue":null,"work_id":"143bfefb-fa01-4d38-80c8-71e02f67fa7b","year":null},"citing_paper":{"arxiv_id":"2507.14748","last_updated":"2025-07-19T20:48:46Z","snapshot_observed_at":"2026-08-15T18:16:12.405822Z","submitted_at":"2025-07-19T20:48:46Z","title":"Skill Learning via Policy Diversity Yields Identifiable Representations for Reinforcement Learning","version":1},"reference_index":77,"source":"pdf_text","source_observed_at":"2026-08-06T15:57:01.366993Z"},"links":{"citing_paper":"/paper/2507.14748"},"observation_digest":"sha256:b58d41a527c38936e4d9e8819601cee2da1cafb3660e96b952529d2c4475ebff","observation_id":"7ae660a5-ec3a-41ce-90ed-91b6a525e1e2","resolution":{"observed_at":"2026-08-06T15:57:04.312876Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T15:57:05.189370Z","title":null,"venue":null,"work_id":"d6b1d2e4-9759-485f-bb7e-d39de70851aa","year":null},"citing_paper":{"arxiv_id":"2507.14748","last_updated":"2025-07-19T20:48:46Z","snapshot_observed_at":"2026-08-15T18:16:12.405822Z","submitted_at":"2025-07-19T20:48:46Z","title":"Skill Learning via Policy Diversity Yields Identifiable Representations for Reinforcement Learning","version":1},"reference_index":2019,"source":"pdf_text","source_observed_at":"2026-08-06T15:56:55.057117Z"},"links":{"citing_paper":"/paper/2507.14748"},"observation_digest":"sha256:e5f43c44c55069c1073527a70005d278d98d7535368172b1784eae4364d90472","observation_id":"15b984e2-dcf0-4b3f-b4f8-03845e30e3a6","resolution":{"observed_at":"2026-08-06T15:57:05.194691Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T15:57:05.269228Z","title":"1, 3, 4, 5, 9","venue":null,"work_id":"a74a1acf-1023-48d2-b4ee-7ae1b44b7bad","year":2022},"citing_paper":{"arxiv_id":"2507.14748","last_updated":"2025-07-19T20:48:46Z","snapshot_observed_at":"2026-08-15T18:16:12.405822Z","submitted_at":"2025-07-19T20:48:46Z","title":"Skill Learning via Policy Diversity Yields Identifiable Representations for Reinforcement Learning","version":1},"reference_index":2022,"source":"pdf_text","source_observed_at":"2026-08-06T15:56:54.403359Z"},"links":{"citing_paper":"/paper/2507.14748"},"observation_digest":"sha256:dd533a8c94aaa949bb7fb2561606198a5f1f741f22b7985c9dbc478d0a64722e","observation_id":"5010bf1c-db5d-467d-9b88-6ea248affe83","resolution":{"observed_at":"2026-08-06T15:57:05.278789Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}}],"paper":{"arxiv_id":"2507.14748","last_updated":"2025-07-19T20:48:46Z","latest_version":1,"primary_category":"cs.LG","snapshot_observed_at":"2026-08-15T18:16:12.405822Z","submitted_at":"2025-07-19T20:48:46Z","title":"Skill Learning via Policy Diversity Yields Identifiable Representations for Reinforcement Learning"},"reference_resolution":{"displayed":77,"state_counts":{"malformed_identifier":1,"metadata_mismatch":3,"parse_uncertain":0,"unresolved":37,"verified_exact":8,"verified_fuzzy":28},"total_outbound_references":77},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"thesis":"As of 21 August 2026, this Paper Citation Record lists 77 of 77 outbound references and 1 inbound Pith citation observation for arXiv:2507.14748."}