{"as_of":"2026-08-14T18:07:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:98888feb21587d8d415a2feef42dac32f5009dc23072c74bf7736c1732bdad81","coverage":[{"denominator":65,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":65,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-07T00:27:00.722538Z","state":"measured"},{"denominator":65,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":65,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-14T06:32:32.682623+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2506.14420/citation-record","integrity":"/paper/2506.14420/integrity","json":"/paper/2506.14420/citation-record.json","paper":"/paper/2506.14420"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T00:27:00.400282Z","title":"A general reinforcement learning algorithm that masters chess, shogi, and go through self-play,","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2506.14420","last_updated":"2025-06-17T11:30:04Z","snapshot_observed_at":"2026-08-09T18:22:45.556028Z","submitted_at":"2025-06-17T11:30:04Z","title":"Unsupervised Skill Discovery through Skill Regions Differentiation","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-07T00:27:00.400282Z"},"links":{"citing_paper":"/paper/2506.14420"},"observation_digest":"sha256:3bf18d249b8ccec948040c511a58d58dfc690f685d799ccf21da35ed15d4d922","observation_id":"71f17265-6779-4c69-a3c3-c18f62a0d420","resolution":{"observed_at":"2026-08-07T00:27:00.400282Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T00:27:01.367589Z","title":"Mastering atari games with limited data,","venue":null,"work_id":"9395258c-7d19-414d-a381-35fe3fed7d5e","year":2021},"citing_paper":{"arxiv_id":"2506.14420","last_updated":"2025-06-17T11:30:04Z","snapshot_observed_at":"2026-08-09T18:22:45.556028Z","submitted_at":"2025-06-17T11:30:04Z","title":"Unsupervised Skill Discovery through Skill Regions Differentiation","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-07T00:27:00.406553Z"},"links":{"citing_paper":"/paper/2506.14420"},"observation_digest":"sha256:6e214ea1ce39de27d2727ae02111c83a69f1c7c6949e4da6f0d13d48fc7d417a","observation_id":"ef1d3c3a-ae07-49e5-adc8-6e5fb3e25493","resolution":{"observed_at":"2026-08-07T00:27:01.370724Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T00:27:01.357698Z","title":"Continu- ous improvement of self-driving cars using dynamic confidence-aware reinforcement learning,","venue":null,"work_id":"e72b7bff-3243-4ee2-85d8-f02d3f878074","year":2023},"citing_paper":{"arxiv_id":"2506.14420","last_updated":"2025-06-17T11:30:04Z","snapshot_observed_at":"2026-08-09T18:22:45.556028Z","submitted_at":"2025-06-17T11:30:04Z","title":"Unsupervised Skill Discovery through Skill Regions Differentiation","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-07T00:27:00.410591Z"},"links":{"citing_paper":"/paper/2506.14420"},"observation_digest":"sha256:3bdda40520bafb428d3f61da6775d0fc89464fac6bb829a0f0116a0e9a1922a4","observation_id":"b2ec47ef-7373-48d0-a232-25be158a95b7","resolution":{"observed_at":"2026-08-07T00:27:01.360799Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T00:27:01.347684Z","title":"Uncertainty-aware model-based reinforce- ment learning: Methodology and application in autonomous driving,","venue":null,"work_id":"e2c28c50-02a8-49b2-892f-c42307b14eb1","year":2022},"citing_paper":{"arxiv_id":"2506.14420","last_updated":"2025-06-17T11:30:04Z","snapshot_observed_at":"2026-08-09T18:22:45.556028Z","submitted_at":"2025-06-17T11:30:04Z","title":"Unsupervised Skill Discovery through Skill Regions Differentiation","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-07T00:27:00.415890Z"},"links":{"citing_paper":"/paper/2506.14420"},"observation_digest":"sha256:9a158b211cb5d3b83df15d3c2216782c4ac4656680533e4f48fc5366c7c0e5bd","observation_id":"8394700b-fd26-46cf-b2d3-dd2159d76866","resolution":{"observed_at":"2026-08-07T00:27:01.350983Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T00:27:01.337561Z","title":"Temporal difference learning for model predictive control,","venue":null,"work_id":"fe13fe58-6e7c-47c5-a87d-8313ef157e34","year":2022},"citing_paper":{"arxiv_id":"2506.14420","last_updated":"2025-06-17T11:30:04Z","snapshot_observed_at":"2026-08-09T18:22:45.556028Z","submitted_at":"2025-06-17T11:30:04Z","title":"Unsupervised Skill Discovery through Skill Regions Differentiation","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-07T00:27:00.421942Z"},"links":{"citing_paper":"/paper/2506.14420"},"observation_digest":"sha256:56cd421c2ce26bf1be566cb71c9a8ba246fbf6a56287c35072904308bd2849d7","observation_id":"704b35af-edb4-4fd9-9afc-82911f0acd5c","resolution":{"observed_at":"2026-08-07T00:27:01.340781Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T00:27:01.327288Z","title":"Learning robust perceptive locomotion for quadrupedal robots in the wild,","venue":null,"work_id":"6b08e87b-f7fc-4029-be35-815ce7f9979b","year":2022},"citing_paper":{"arxiv_id":"2506.14420","last_updated":"2025-06-17T11:30:04Z","snapshot_observed_at":"2026-08-09T18:22:45.556028Z","submitted_at":"2025-06-17T11:30:04Z","title":"Unsupervised Skill Discovery through Skill Regions Differentiation","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-07T00:27:00.426007Z"},"links":{"citing_paper":"/paper/2506.14420"},"observation_digest":"sha256:952eef4ef086fc8e88512d17d37673a9201a04c1748e0a2e0295dee0ed1e502d","observation_id":"ed24a445-4e3a-4971-a598-29b233b89200","resolution":{"observed_at":"2026-08-07T00:27:01.330608Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T00:27:00.430953Z","title":"Relay hindsight experience replay: Self-guided continual reinforcement learning for sequential object manipulation tasks with sparse rewards,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.14420","last_updated":"2025-06-17T11:30:04Z","snapshot_observed_at":"2026-08-09T18:22:45.556028Z","submitted_at":"2025-06-17T11:30:04Z","title":"Unsupervised Skill Discovery through Skill Regions Differentiation","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-07T00:27:00.430953Z"},"links":{"citing_paper":"/paper/2506.14420"},"observation_digest":"sha256:96847c875a702ae62c2e5cc8ba9309d159df4593178c0809e37053aa3871e0fd","observation_id":"8dde356a-dbf6-43df-8776-353702a37f9c","resolution":{"observed_at":"2026-08-07T00:27:00.430953Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T00:27:01.310271Z","title":"Reward design with language models,","venue":null,"work_id":"9b787363-7409-4d1b-ae09-089809456f69","year":2023},"citing_paper":{"arxiv_id":"2506.14420","last_updated":"2025-06-17T11:30:04Z","snapshot_observed_at":"2026-08-09T18:22:45.556028Z","submitted_at":"2025-06-17T11:30:04Z","title":"Unsupervised Skill Discovery through Skill Regions Differentiation","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-07T00:27:00.434350Z"},"links":{"citing_paper":"/paper/2506.14420"},"observation_digest":"sha256:c15fb248c99f0d7e097e1a7942a813e53825abb17a22cdf5fec2ea56dd2c85ea","observation_id":"e58e16ff-5cdf-4271-b646-8e358a74f9e9","resolution":{"observed_at":"2026-08-07T00:27:01.314030Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T00:27:01.300304Z","title":"Maniskill2: A unified benchmark for generalizable manipulation skills,","venue":null,"work_id":"921a6627-281d-4b27-863c-d33704eb83e2","year":2023},"citing_paper":{"arxiv_id":"2506.14420","last_updated":"2025-06-17T11:30:04Z","snapshot_observed_at":"2026-08-09T18:22:45.556028Z","submitted_at":"2025-06-17T11:30:04Z","title":"Unsupervised Skill Discovery through Skill Regions Differentiation","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-07T00:27:00.438282Z"},"links":{"citing_paper":"/paper/2506.14420"},"observation_digest":"sha256:1f638cf8eb98c7589f8105317fb5c6831202409f821cb13e0434b4d624bd5bd3","observation_id":"d4c1edc9-f530-46c2-bf7b-c3e216841b4f","resolution":{"observed_at":"2026-08-07T00:27:01.303638Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T00:27:01.289921Z","title":"Pre-trained models: Past, present and future,","venue":null,"work_id":"2621b3bf-8135-4806-9d5d-8f7a0373cc68","year":2021},"citing_paper":{"arxiv_id":"2506.14420","last_updated":"2025-06-17T11:30:04Z","snapshot_observed_at":"2026-08-09T18:22:45.556028Z","submitted_at":"2025-06-17T11:30:04Z","title":"Unsupervised Skill Discovery through Skill Regions Differentiation","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-07T00:27:00.443129Z"},"links":{"citing_paper":"/paper/2506.14420"},"observation_digest":"sha256:05859da8bdefda51068ab7a23396e0cef58fc4966614ccfbd94a645976b2985f","observation_id":"619f9568-8743-48ab-b70a-aa94a8152069","resolution":{"observed_at":"2026-08-07T00:27:01.293541Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2303.08774","last_updated":"2024-03-04T06:01:33Z","snapshot_observed_at":"2026-08-07T07:30:12.213965Z","submitted_at":"2023-03-15T17:15:04Z","title":"GPT-4 Technical Report","version":6},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2303.08774","snapshot_observed_at":"2026-08-07T00:27:00.448023Z","title":"Gpt-4 technical report,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.14420","last_updated":"2025-06-17T11:30:04Z","snapshot_observed_at":"2026-08-09T18:22:45.556028Z","submitted_at":"2025-06-17T11:30:04Z","title":"Unsupervised Skill Discovery through Skill Regions Differentiation","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-07T00:27:00.448023Z"},"links":{"cited_paper":"/paper/2303.08774","citing_paper":"/paper/2506.14420"},"observation_digest":"sha256:2c3fd45bce991910709630771ac269d779558d9167556c3be4d2043d5f58ac8e","observation_id":"4fd48582-3036-4fbe-860a-e6ca0ba79d71","resolution":{"observed_at":"2026-08-07T00:27:00.448023Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T00:27:00.452438Z","title":"Training language models to follow instructions with human feedback,","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2506.14420","last_updated":"2025-06-17T11:30:04Z","snapshot_observed_at":"2026-08-09T18:22:45.556028Z","submitted_at":"2025-06-17T11:30:04Z","title":"Unsupervised Skill Discovery through Skill Regions Differentiation","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-07T00:27:00.452438Z"},"links":{"citing_paper":"/paper/2506.14420"},"observation_digest":"sha256:b93d9ed363a924868448e3ac4933aca7e131544ab3c7f6d3c5c17f595ee98965","observation_id":"a57c93fb-c2b9-415d-9369-dde7bd856de2","resolution":{"observed_at":"2026-08-07T00:27:00.452438Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2307.09288","last_updated":"2023-07-19T17:08:59Z","snapshot_observed_at":"2026-08-07T12:56:43.323460Z","submitted_at":"2023-07-18T14:31:57Z","title":"Llama 2: Open Foundation and Fine-Tuned Chat Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2307.09288","snapshot_observed_at":"2026-08-07T00:27:00.456970Z","title":"Llama 2: Open foundation and fine-tuned chat models,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.14420","last_updated":"2025-06-17T11:30:04Z","snapshot_observed_at":"2026-08-09T18:22:45.556028Z","submitted_at":"2025-06-17T11:30:04Z","title":"Unsupervised Skill Discovery through Skill Regions Differentiation","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-07T00:27:00.456970Z"},"links":{"cited_paper":"/paper/2307.09288","citing_paper":"/paper/2506.14420"},"observation_digest":"sha256:95a61f2ec1c54a9619902016aa615ad99c64a2fd776a8cf8e9fc9fe05f7f2f4d","observation_id":"6011ef50-a54c-4a95-9f8a-97e8b97c3e0f","resolution":{"observed_at":"2026-08-07T00:27:00.456970Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T00:27:00.461759Z","title":"Masked au- toencoders are scalable vision learners,","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2506.14420","last_updated":"2025-06-17T11:30:04Z","snapshot_observed_at":"2026-08-09T18:22:45.556028Z","submitted_at":"2025-06-17T11:30:04Z","title":"Unsupervised Skill Discovery through Skill Regions Differentiation","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-07T00:27:00.461759Z"},"links":{"citing_paper":"/paper/2506.14420"},"observation_digest":"sha256:73b3cb434f6e34b5156d0c6ede0ea36aa6371caeb02fc41e739ef0916e2a45c6","observation_id":"226fe321-0ecf-4b4d-aff0-bbe46e7b5c6e","resolution":{"observed_at":"2026-08-07T00:27:00.461759Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T00:27:01.265313Z","title":"V-JEPA: Latent video prediction for visual representation learning,","venue":null,"work_id":"52f59ae8-a22e-44af-9d92-9d4c3e05e9a6","year":2024},"citing_paper":{"arxiv_id":"2506.14420","last_updated":"2025-06-17T11:30:04Z","snapshot_observed_at":"2026-08-09T18:22:45.556028Z","submitted_at":"2025-06-17T11:30:04Z","title":"Unsupervised Skill Discovery through Skill Regions Differentiation","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-07T00:27:00.465949Z"},"links":{"citing_paper":"/paper/2506.14420"},"observation_digest":"sha256:1fc5fe327cd7b1d0b75bc551152573b1fcf865f2f4441f6a5437c72c047505fb","observation_id":"fe02bf74-1ab5-4135-b72a-c480516daa08","resolution":{"observed_at":"2026-08-07T00:27:01.268456Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T00:27:00.472353Z","title":"Bootstrap your own latent-a new approach to self-supervised learning,","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2506.14420","last_updated":"2025-06-17T11:30:04Z","snapshot_observed_at":"2026-08-09T18:22:45.556028Z","submitted_at":"2025-06-17T11:30:04Z","title":"Unsupervised Skill Discovery through Skill Regions Differentiation","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-07T00:27:00.472353Z"},"links":{"citing_paper":"/paper/2506.14420"},"observation_digest":"sha256:cdd99d3d059be6247c51174b0cd16b3d98a92e376f3cc6dc1cebc56db8401d40","observation_id":"b20b188b-cf5e-4a2c-8a52-136036aad63f","resolution":{"observed_at":"2026-08-07T00:27:00.472353Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T00:27:01.246972Z","title":"Where are we in the search for an artificial visual cortex for embodied intelligence?","venue":null,"work_id":"0d82c016-0eb8-4ca6-98f5-b313ba9bdcb8","year":2023},"citing_paper":{"arxiv_id":"2506.14420","last_updated":"2025-06-17T11:30:04Z","snapshot_observed_at":"2026-08-09T18:22:45.556028Z","submitted_at":"2025-06-17T11:30:04Z","title":"Unsupervised Skill Discovery through Skill Regions Differentiation","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-07T00:27:00.478396Z"},"links":{"citing_paper":"/paper/2506.14420"},"observation_digest":"sha256:390f9e41d5cf8aeec3300c37301c8ff191d18035ec93db9458a0ffd786e21d60","observation_id":"30b3293a-b4c1-4a8c-83b1-2ed348eb81f4","resolution":{"observed_at":"2026-08-07T00:27:01.250413Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T00:27:01.237010Z","title":"R3m: A universal visual representation for robot manipulation,","venue":null,"work_id":"5dddfd75-5c60-4821-9f8d-898ba80ea936","year":2023},"citing_paper":{"arxiv_id":"2506.14420","last_updated":"2025-06-17T11:30:04Z","snapshot_observed_at":"2026-08-09T18:22:45.556028Z","submitted_at":"2025-06-17T11:30:04Z","title":"Unsupervised Skill Discovery through Skill Regions Differentiation","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-07T00:27:00.485375Z"},"links":{"citing_paper":"/paper/2506.14420"},"observation_digest":"sha256:e9f960c737396b4e9b4961b2f6171c39df2e879cff45596a8122c988d0b15122","observation_id":"220c38ac-5d7d-4b90-bcd2-44cddea60b37","resolution":{"observed_at":"2026-08-07T00:27:01.240433Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T00:27:01.226153Z","title":"URLB: Unsupervised reinforcement learning benchmark,","venue":null,"work_id":"b383b909-e5b8-4144-81e3-5ceb17d03cb3","year":2021},"citing_paper":{"arxiv_id":"2506.14420","last_updated":"2025-06-17T11:30:04Z","snapshot_observed_at":"2026-08-09T18:22:45.556028Z","submitted_at":"2025-06-17T11:30:04Z","title":"Unsupervised Skill Discovery through Skill Regions Differentiation","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-07T00:27:00.489329Z"},"links":{"citing_paper":"/paper/2506.14420"},"observation_digest":"sha256:599d61512caba8cefc0e90678128a5494eafdd50b800b6e95d384a87645fa9e6","observation_id":"36d4a9dc-19eb-4d33-801a-cf0dfc0a383f","resolution":{"observed_at":"2026-08-07T00:27:01.230131Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1611.07507","last_updated":"2016-11-22T20:44:39Z","snapshot_observed_at":"2026-08-02T15:05:52.307944Z","submitted_at":"2016-11-22T20:44:39Z","title":"Variational Intrinsic Control","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1611.07507","snapshot_observed_at":"2026-08-07T00:27:00.497698Z","title":"Variational intrinsic control,","venue":null,"work_id":null,"year":2016},"citing_paper":{"arxiv_id":"2506.14420","last_updated":"2025-06-17T11:30:04Z","snapshot_observed_at":"2026-08-09T18:22:45.556028Z","submitted_at":"2025-06-17T11:30:04Z","title":"Unsupervised Skill Discovery through Skill Regions Differentiation","version":1},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-07T00:27:00.497698Z"},"links":{"cited_paper":"/paper/1611.07507","citing_paper":"/paper/2506.14420"},"observation_digest":"sha256:3e59c39116c169ad879c9e4cbc3b57c112db7b2b8a19476b99b11eda509cf569","observation_id":"904361d9-e69c-40ef-bd35-575853178d1d","resolution":{"observed_at":"2026-08-07T00:27:00.497698Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T00:27:01.215675Z","title":"Behavior from the void: Unsupervised active pre-training,","venue":null,"work_id":"67b63949-3d48-41f5-8fe5-31cd1c08678a","year":2021},"citing_paper":{"arxiv_id":"2506.14420","last_updated":"2025-06-17T11:30:04Z","snapshot_observed_at":"2026-08-09T18:22:45.556028Z","submitted_at":"2025-06-17T11:30:04Z","title":"Unsupervised Skill Discovery through Skill Regions Differentiation","version":1},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-07T00:27:00.501331Z"},"links":{"citing_paper":"/paper/2506.14420"},"observation_digest":"sha256:93c3b1057f56d5744e3c51f8e4b6567b5f42fd116eba4ff4d80af7e6d657d21f","observation_id":"7b6e1eed-5803-4e2e-8b8c-5842aef46ac9","resolution":{"observed_at":"2026-08-07T00:27:01.219172Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T00:27:01.203505Z","title":"Understanding the limitations of variational mutual information estimators,","venue":null,"work_id":"548a9cf6-863b-4e34-a3c6-22ec9601ad69","year":2020},"citing_paper":{"arxiv_id":"2506.14420","last_updated":"2025-06-17T11:30:04Z","snapshot_observed_at":"2026-08-09T18:22:45.556028Z","submitted_at":"2025-06-17T11:30:04Z","title":"Unsupervised Skill Discovery through Skill Regions Differentiation","version":1},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-07T00:27:00.505838Z"},"links":{"citing_paper":"/paper/2506.14420"},"observation_digest":"sha256:c2eec8ed2116af0aba865dcb7d7f4d0bf19b6c181d5afd07d43e20d5e64a6875","observation_id":"a619baad-5a87-4765-9ed0-96b73d1ae417","resolution":{"observed_at":"2026-08-07T00:27:01.207390Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T00:27:01.192535Z","title":"Diversity is all you need: Learning skills without a reward function,","venue":null,"work_id":"46e46f40-eb9e-4b45-bc3a-062f551be9ac","year":2019},"citing_paper":{"arxiv_id":"2506.14420","last_updated":"2025-06-17T11:30:04Z","snapshot_observed_at":"2026-08-09T18:22:45.556028Z","submitted_at":"2025-06-17T11:30:04Z","title":"Unsupervised Skill Discovery through Skill Regions Differentiation","version":1},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-07T00:27:00.510281Z"},"links":{"citing_paper":"/paper/2506.14420"},"observation_digest":"sha256:ba952e9eadd918a1594f8825a4acda310666530577024f8e1308a25bfe43c200","observation_id":"310b62bc-be25-4cdf-96d8-474153cd3b5c","resolution":{"observed_at":"2026-08-07T00:27:01.196242Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T00:27:01.182466Z","title":"Behavior contrastive learning for unsupervised skill discovery,","venue":null,"work_id":"d92ae496-1623-4209-8a25-eb80c9b7b846","year":2023},"citing_paper":{"arxiv_id":"2506.14420","last_updated":"2025-06-17T11:30:04Z","snapshot_observed_at":"2026-08-09T18:22:45.556028Z","submitted_at":"2025-06-17T11:30:04Z","title":"Unsupervised Skill Discovery through Skill Regions Differentiation","version":1},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-07T00:27:00.514388Z"},"links":{"citing_paper":"/paper/2506.14420"},"observation_digest":"sha256:5df035b392d65e187d6c2ed507df2559047e826a22d77246901346a943214ec1","observation_id":"0eaa15a3-04d2-4e2a-b9e0-2a1cf9db9cdc","resolution":{"observed_at":"2026-08-07T00:27:01.185751Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T00:27:01.171542Z","title":"METRA: Scalable unsupervised RL with metric-aware abstraction,","venue":null,"work_id":"0a064f8d-a33a-4823-90fa-654e5cb51bea","year":2024},"citing_paper":{"arxiv_id":"2506.14420","last_updated":"2025-06-17T11:30:04Z","snapshot_observed_at":"2026-08-09T18:22:45.556028Z","submitted_at":"2025-06-17T11:30:04Z","title":"Unsupervised Skill Discovery through Skill Regions Differentiation","version":1},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-08-07T00:27:00.520823Z"},"links":{"citing_paper":"/paper/2506.14420"},"observation_digest":"sha256:f53f0f5ecffd0439932ca0db468ba6ec0baf0a63918a8005ce7a129d3a85d38e","observation_id":"5f7cea8d-1147-4b16-82f1-665d802b6b56","resolution":{"observed_at":"2026-08-07T00:27:01.174666Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T00:27:00.530003Z","title":"Lipschitz-constrained unsupervised skill discovery,","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2506.14420","last_updated":"2025-06-17T11:30:04Z","snapshot_observed_at":"2026-08-09T18:22:45.556028Z","submitted_at":"2025-06-17T11:30:04Z","title":"Unsupervised Skill Discovery through Skill Regions Differentiation","version":1},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-08-07T00:27:00.530003Z"},"links":{"citing_paper":"/paper/2506.14420"},"observation_digest":"sha256:b1a5efc12c4dab76f822db2dca7d721d163c321e8a7730520e5481004f06d6df","observation_id":"455f1e32-4fc6-44e9-a00c-3ae7ae9e7605","resolution":{"observed_at":"2026-08-07T00:27:00.530003Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T00:27:01.153881Z","title":"Controllability-aware unsuper- vised skill discovery,","venue":null,"work_id":"c90e1170-98a3-46e1-91e6-1eef2cf2a975","year":2023},"citing_paper":{"arxiv_id":"2506.14420","last_updated":"2025-06-17T11:30:04Z","snapshot_observed_at":"2026-08-09T18:22:45.556028Z","submitted_at":"2025-06-17T11:30:04Z","title":"Unsupervised Skill Discovery through Skill Regions Differentiation","version":1},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-08-07T00:27:00.540883Z"},"links":{"citing_paper":"/paper/2506.14420"},"observation_digest":"sha256:5d9167263fd28345b4bd0c2d04b9e6931e9007badb76d672b2247c673793c06b","observation_id":"8e11a816-fa34-4e9e-9f6b-eb50d1a3912a","resolution":{"observed_at":"2026-08-07T00:27:01.157930Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T00:27:01.142595Z","title":"Unsupervised reinforcement learning with contrastive intrinsic control,","venue":null,"work_id":"9f0972b1-d7af-48d1-8172-15c9678998a0","year":2022},"citing_paper":{"arxiv_id":"2506.14420","last_updated":"2025-06-17T11:30:04Z","snapshot_observed_at":"2026-08-09T18:22:45.556028Z","submitted_at":"2025-06-17T11:30:04Z","title":"Unsupervised Skill Discovery through Skill Regions Differentiation","version":1},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-08-07T00:27:00.554184Z"},"links":{"citing_paper":"/paper/2506.14420"},"observation_digest":"sha256:ad0bb564a5b5bab274734ff366bd7e14194634e222b9a73bcf56bec6076ba53e","observation_id":"0151c8b4-a341-4e52-add7-ba2c19c31fe1","resolution":{"observed_at":"2026-08-07T00:27:01.146584Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T00:27:01.132003Z","title":"Mastering the unsupervised reinforce- ment learning benchmark from pixels,","venue":null,"work_id":"3afab83c-b132-4822-9d77-6fb083502730","year":2023},"citing_paper":{"arxiv_id":"2506.14420","last_updated":"2025-06-17T11:30:04Z","snapshot_observed_at":"2026-08-09T18:22:45.556028Z","submitted_at":"2025-06-17T11:30:04Z","title":"Unsupervised Skill Discovery through Skill Regions Differentiation","version":1},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-08-07T00:27:00.565679Z"},"links":{"citing_paper":"/paper/2506.14420"},"observation_digest":"sha256:ba4efa00ea60e45a416de978b704aea6f3de33440f94a5c8b246496634ca63f7","observation_id":"9834ffa6-f4e4-4a50-bde2-7cc8dff66686","resolution":{"observed_at":"2026-08-07T00:27:01.135541Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1312.6114","last_updated":"2022-12-10T21:04:00Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2013-12-20T20:58:10Z","title":"Auto-Encoding Variational Bayes","version":11},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1312.6114","snapshot_observed_at":"2026-08-07T00:27:00.580787Z","title":"Auto-encoding variational bayes,","venue":null,"work_id":null,"year":2013},"citing_paper":{"arxiv_id":"2506.14420","last_updated":"2025-06-17T11:30:04Z","snapshot_observed_at":"2026-08-09T18:22:45.556028Z","submitted_at":"2025-06-17T11:30:04Z","title":"Unsupervised Skill Discovery through Skill Regions Differentiation","version":1},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-08-07T00:27:00.580787Z"},"links":{"cited_paper":"/paper/1312.6114","citing_paper":"/paper/2506.14420"},"observation_digest":"sha256:5448551ed7cbd3b2dbd5d1f3b8222a1867e331c675cc4eb2678e0335ff154240","observation_id":"eb901812-b8f3-4efb-8a55-47a2b42fc20c","resolution":{"observed_at":"2026-08-07T00:27:00.580787Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T00:27:00.594940Z","title":"An introduction to variational autoencoders,","venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2506.14420","last_updated":"2025-06-17T11:30:04Z","snapshot_observed_at":"2026-08-09T18:22:45.556028Z","submitted_at":"2025-06-17T11:30:04Z","title":"Unsupervised Skill Discovery through Skill Regions Differentiation","version":1},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-08-07T00:27:00.594940Z"},"links":{"citing_paper":"/paper/2506.14420"},"observation_digest":"sha256:5f36203c25f82176c08825ac53d9c7640ba093278776d3661fde6949671066fc","observation_id":"657529dc-3a0d-4c4c-b252-2c7bf0b89cc7","resolution":{"observed_at":"2026-08-07T00:27:00.594940Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T00:27:01.114739Z","title":"Multi-task reinforcement learning with soft modularization,","venue":null,"work_id":"f303c3af-7539-43dd-987c-d844b172e513","year":2020},"citing_paper":{"arxiv_id":"2506.14420","last_updated":"2025-06-17T11:30:04Z","snapshot_observed_at":"2026-08-09T18:22:45.556028Z","submitted_at":"2025-06-17T11:30:04Z","title":"Unsupervised Skill Discovery through Skill Regions Differentiation","version":1},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-08-07T00:27:00.598765Z"},"links":{"citing_paper":"/paper/2506.14420"},"observation_digest":"sha256:31372c6a5687bcfaab5ec8f718e275732f7109121eeba90e68be8f404f2ca990","observation_id":"bf395112-8f86-4dee-8e21-659391494978","resolution":{"observed_at":"2026-08-07T00:27:01.118194Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T00:27:01.104109Z","title":"Near-bayesian exploration in polynomial time,","venue":null,"work_id":"1f8c46fc-ec19-46fc-bb4c-9c890da4aeb1","year":2009},"citing_paper":{"arxiv_id":"2506.14420","last_updated":"2025-06-17T11:30:04Z","snapshot_observed_at":"2026-08-09T18:22:45.556028Z","submitted_at":"2025-06-17T11:30:04Z","title":"Unsupervised Skill Discovery through Skill Regions Differentiation","version":1},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-08-07T00:27:00.606260Z"},"links":{"citing_paper":"/paper/2506.14420"},"observation_digest":"sha256:73c41bc7c3a2451689ec6600c2f8e96a2adc794fade51022055e40c7ccd5cce8","observation_id":"83799067-9158-4cf0-8018-88614f6ce87f","resolution":{"observed_at":"2026-08-07T00:27:01.107853Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T00:27:01.093558Z","title":"An analysis of model-based interval estimation for markov decision processes,","venue":null,"work_id":"b5b8b1af-f741-468a-94c0-8f209747cac4","year":2008},"citing_paper":{"arxiv_id":"2506.14420","last_updated":"2025-06-17T11:30:04Z","snapshot_observed_at":"2026-08-09T18:22:45.556028Z","submitted_at":"2025-06-17T11:30:04Z","title":"Unsupervised Skill Discovery through Skill Regions Differentiation","version":1},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-08-07T00:27:00.609774Z"},"links":{"citing_paper":"/paper/2506.14420"},"observation_digest":"sha256:1242ecdbf119d702f7e8a2fa037a6e71a79cfbc67e7046d50b1a8f2457d42f72","observation_id":"772d9560-1c81-45ba-bc53-39168129a0c9","resolution":{"observed_at":"2026-08-07T00:27:01.096620Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T00:27:01.084499Z","title":"Unifying count-based exploration and intrinsic motivation,","venue":null,"work_id":"7eb532ca-e1b5-44de-a287-b009ae357fe8","year":2016},"citing_paper":{"arxiv_id":"2506.14420","last_updated":"2025-06-17T11:30:04Z","snapshot_observed_at":"2026-08-09T18:22:45.556028Z","submitted_at":"2025-06-17T11:30:04Z","title":"Unsupervised Skill Discovery through Skill Regions Differentiation","version":1},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-08-07T00:27:00.612633Z"},"links":{"citing_paper":"/paper/2506.14420"},"observation_digest":"sha256:b4d83eef3b89913051e056d1e81a2d33805b0ae16bae0bef3d69eda1ce8199a2","observation_id":"2809328a-2103-4dae-befb-55cdcac852fd","resolution":{"observed_at":"2026-08-07T00:27:01.087603Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T00:27:01.074734Z","title":"Count-based exploration with neural density models,","venue":null,"work_id":"a11d7da9-0a83-4afb-bb95-c46732a1a0ae","year":2017},"citing_paper":{"arxiv_id":"2506.14420","last_updated":"2025-06-17T11:30:04Z","snapshot_observed_at":"2026-08-09T18:22:45.556028Z","submitted_at":"2025-06-17T11:30:04Z","title":"Unsupervised Skill Discovery through Skill Regions Differentiation","version":1},"reference_index":36,"source":"pdf_text","source_observed_at":"2026-08-07T00:27:00.616640Z"},"links":{"citing_paper":"/paper/2506.14420"},"observation_digest":"sha256:2e921d504b91f497b88c0331f78bab084b6f16eecac73b48b78932d8600e5d83","observation_id":"072ed9ba-5c18-4643-97a3-a90c2c7dcb13","resolution":{"observed_at":"2026-08-07T00:27:01.078190Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T00:27:01.064814Z","title":"Dynamics- aware unsupervised discovery of skills,","venue":null,"work_id":"252993e7-ea50-40f3-8706-39961e9e6c43","year":2020},"citing_paper":{"arxiv_id":"2506.14420","last_updated":"2025-06-17T11:30:04Z","snapshot_observed_at":"2026-08-09T18:22:45.556028Z","submitted_at":"2025-06-17T11:30:04Z","title":"Unsupervised Skill Discovery through Skill Regions Differentiation","version":1},"reference_index":37,"source":"pdf_text","source_observed_at":"2026-08-07T00:27:00.619907Z"},"links":{"citing_paper":"/paper/2506.14420"},"observation_digest":"sha256:f513e391f3bd0f6f3f4418f47eb5f76390b71a6bbb423b95dd541b2adc876d57","observation_id":"530eb6f2-b55d-4f03-9206-a4563300a6aa","resolution":{"observed_at":"2026-08-07T00:27:01.068018Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T00:27:01.055474Z","title":"Explore, discover and learn: Unsupervised discovery of state-covering skills,","venue":null,"work_id":"86592fcd-8e9e-446e-8a0e-95526d0104b2","year":2020},"citing_paper":{"arxiv_id":"2506.14420","last_updated":"2025-06-17T11:30:04Z","snapshot_observed_at":"2026-08-09T18:22:45.556028Z","submitted_at":"2025-06-17T11:30:04Z","title":"Unsupervised Skill Discovery through Skill Regions Differentiation","version":1},"reference_index":38,"source":"pdf_text","source_observed_at":"2026-08-07T00:27:00.623315Z"},"links":{"citing_paper":"/paper/2506.14420"},"observation_digest":"sha256:e38efbcffe9d7ff5eb3a5181c50570088b494ea171d7b6573fd7339715f91484","observation_id":"cfa7a766-a5eb-47db-a842-e327c7ea0c66","resolution":{"observed_at":"2026-08-07T00:27:01.058443Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T00:27:01.045509Z","title":"Unsupervised skill discovery via recurrent skill training,","venue":null,"work_id":"7aced0a7-cca6-4342-b32e-eece8112e81e","year":2022},"citing_paper":{"arxiv_id":"2506.14420","last_updated":"2025-06-17T11:30:04Z","snapshot_observed_at":"2026-08-09T18:22:45.556028Z","submitted_at":"2025-06-17T11:30:04Z","title":"Unsupervised Skill Discovery through Skill Regions Differentiation","version":1},"reference_index":39,"source":"pdf_text","source_observed_at":"2026-08-07T00:27:00.626404Z"},"links":{"citing_paper":"/paper/2506.14420"},"observation_digest":"sha256:8d5ff3cfc126218ddddb8e3360c0182f987a961248c5a70dec81a92e4396b214","observation_id":"4a3bb0fb-7ccb-49ae-b38b-d94623953078","resolution":{"observed_at":"2026-08-07T00:27:01.048859Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T00:27:01.035404Z","title":"Learning to discover skills with guidance,","venue":null,"work_id":"e64c720a-e34b-4d83-84a0-571457022786","year":2023},"citing_paper":{"arxiv_id":"2506.14420","last_updated":"2025-06-17T11:30:04Z","snapshot_observed_at":"2026-08-09T18:22:45.556028Z","submitted_at":"2025-06-17T11:30:04Z","title":"Unsupervised Skill Discovery through Skill Regions Differentiation","version":1},"reference_index":40,"source":"pdf_text","source_observed_at":"2026-08-07T00:27:00.629803Z"},"links":{"citing_paper":"/paper/2506.14420"},"observation_digest":"sha256:9649386123b4bef309af7aa8172cd07c60d05f3e5eb3336c7260e00782570a41","observation_id":"03fd7f24-e87f-48cf-9479-f453ef079ad9","resolution":{"observed_at":"2026-08-07T00:27:01.038583Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T00:27:01.024616Z","title":"Aps: Active pretraining with successor features,","venue":null,"work_id":"5db25783-2f72-47b2-bc7d-6ead5d87ad58","year":2021},"citing_paper":{"arxiv_id":"2506.14420","last_updated":"2025-06-17T11:30:04Z","snapshot_observed_at":"2026-08-09T18:22:45.556028Z","submitted_at":"2025-06-17T11:30:04Z","title":"Unsupervised Skill Discovery through Skill Regions Differentiation","version":1},"reference_index":41,"source":"pdf_text","source_observed_at":"2026-08-07T00:27:00.633081Z"},"links":{"citing_paper":"/paper/2506.14420"},"observation_digest":"sha256:2bdee2c8919a096abbc37dd94ee17f4f65ee26bc3018f476c338e603832b30ef","observation_id":"5bc42a72-5855-459d-98d9-059d07f1d69e","resolution":{"observed_at":"2026-08-07T00:27:01.028714Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T00:27:01.014687Z","title":"Efficient exploration via state marginal matching,","venue":null,"work_id":"6754df8c-1197-4a4f-8c33-b1c4a8396e78","year":null},"citing_paper":{"arxiv_id":"2506.14420","last_updated":"2025-06-17T11:30:04Z","snapshot_observed_at":"2026-08-09T18:22:45.556028Z","submitted_at":"2025-06-17T11:30:04Z","title":"Unsupervised Skill Discovery through Skill Regions Differentiation","version":1},"reference_index":42,"source":"pdf_text","source_observed_at":"2026-08-07T00:27:00.636865Z"},"links":{"citing_paper":"/paper/2506.14420"},"observation_digest":"sha256:f112335066bc3650da04fbb45807d520f70a8bfb2aa799de5f0c046beb4ee6f9","observation_id":"da26a86e-3728-495a-9390-35aa84fa09de","resolution":{"observed_at":"2026-08-07T00:27:01.017875Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T00:27:00.993967Z","title":"Learning more skills through optimistic exploration,","venue":null,"work_id":"ffa5dd48-2609-46a6-a8b1-e992ce937471","year":2022},"citing_paper":{"arxiv_id":"2506.14420","last_updated":"2025-06-17T11:30:04Z","snapshot_observed_at":"2026-08-09T18:22:45.556028Z","submitted_at":"2025-06-17T11:30:04Z","title":"Unsupervised Skill Discovery through Skill Regions Differentiation","version":1},"reference_index":43,"source":"pdf_text","source_observed_at":"2026-08-07T00:27:00.644518Z"},"links":{"citing_paper":"/paper/2506.14420"},"observation_digest":"sha256:4fba4cd2c97c3b3f977861660024f9fdbfc7f62e9aa2cbcb0faed13d8675d708","observation_id":"f32b9b01-64de-403f-95ca-bded11c4e539","resolution":{"observed_at":"2026-08-07T00:27:00.997823Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T00:27:00.984583Z","title":"Choreographer: Learning and adapting skills in imagination,","venue":null,"work_id":"e155effd-66d2-4bd7-994b-7d4623d51e05","year":2023},"citing_paper":{"arxiv_id":"2506.14420","last_updated":"2025-06-17T11:30:04Z","snapshot_observed_at":"2026-08-09T18:22:45.556028Z","submitted_at":"2025-06-17T11:30:04Z","title":"Unsupervised Skill Discovery through Skill Regions Differentiation","version":1},"reference_index":44,"source":"pdf_text","source_observed_at":"2026-08-07T00:27:00.647901Z"},"links":{"citing_paper":"/paper/2506.14420"},"observation_digest":"sha256:8d24ab5df7a9c512a6bdf95174db2b50698830e37766de868e5e4cea3b52893d","observation_id":"f6728e22-9bc1-4fde-bf6b-b38aeb7858cf","resolution":{"observed_at":"2026-08-07T00:27:00.987631Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T00:27:00.975184Z","title":"Curiosity-driven exploration by self-supervised prediction,","venue":null,"work_id":"6485ccb8-3e74-4cd1-ac80-50ccbf77fcbb","year":2017},"citing_paper":{"arxiv_id":"2506.14420","last_updated":"2025-06-17T11:30:04Z","snapshot_observed_at":"2026-08-09T18:22:45.556028Z","submitted_at":"2025-06-17T11:30:04Z","title":"Unsupervised Skill Discovery through Skill Regions Differentiation","version":1},"reference_index":45,"source":"pdf_text","source_observed_at":"2026-08-07T00:27:00.651425Z"},"links":{"citing_paper":"/paper/2506.14420"},"observation_digest":"sha256:dd9cf4e1db5a9cf35a64b85ee4551b1e344fba80d8d78f74a3a32f50a2d61554","observation_id":"57370c5e-b6cf-4ac9-a791-2a0f30a6ab51","resolution":{"observed_at":"2026-08-07T00:27:00.978763Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T00:27:00.965614Z","title":"Self-supervised exploration via disagreement,","venue":null,"work_id":"b8b46c18-6a20-467c-beb2-bad62c620190","year":2019},"citing_paper":{"arxiv_id":"2506.14420","last_updated":"2025-06-17T11:30:04Z","snapshot_observed_at":"2026-08-09T18:22:45.556028Z","submitted_at":"2025-06-17T11:30:04Z","title":"Unsupervised Skill Discovery through Skill Regions Differentiation","version":1},"reference_index":46,"source":"pdf_text","source_observed_at":"2026-08-07T00:27:00.655593Z"},"links":{"citing_paper":"/paper/2506.14420"},"observation_digest":"sha256:bdd67a50e92385f1bd8cf067034023bedb0548e1ee26430d1715674f436dffd2","observation_id":"cd209605-fe50-4286-bb76-0bd9626397f5","resolution":{"observed_at":"2026-08-07T00:27:00.968809Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T00:27:00.956046Z","title":"Exploration by random network distillation,","venue":null,"work_id":"e8e5ac30-5830-43da-a729-c963ed96289a","year":2019},"citing_paper":{"arxiv_id":"2506.14420","last_updated":"2025-06-17T11:30:04Z","snapshot_observed_at":"2026-08-09T18:22:45.556028Z","submitted_at":"2025-06-17T11:30:04Z","title":"Unsupervised Skill Discovery through Skill Regions Differentiation","version":1},"reference_index":47,"source":"pdf_text","source_observed_at":"2026-08-07T00:27:00.659560Z"},"links":{"citing_paper":"/paper/2506.14420"},"observation_digest":"sha256:65cadb022fbefc5f987a14d5f6a8b89ce75c4e369515c6e56788fa6efb3e6b66","observation_id":"6f595c2b-5c8a-4abe-95f3-e0ea93083b26","resolution":{"observed_at":"2026-08-07T00:27:00.959226Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T00:27:00.946671Z","title":"Reinforcement learn- ing with prototypical representations,","venue":null,"work_id":"f6985e43-2576-4998-a75b-45e6c7237349","year":2021},"citing_paper":{"arxiv_id":"2506.14420","last_updated":"2025-06-17T11:30:04Z","snapshot_observed_at":"2026-08-09T18:22:45.556028Z","submitted_at":"2025-06-17T11:30:04Z","title":"Unsupervised Skill Discovery through Skill Regions Differentiation","version":1},"reference_index":48,"source":"pdf_text","source_observed_at":"2026-08-07T00:27:00.662915Z"},"links":{"citing_paper":"/paper/2506.14420"},"observation_digest":"sha256:adffef0f4e8ebc0f6f84b930863957310884efee4ee7fe8cafd883cda0971b35","observation_id":"e160b572-259a-4e80-b456-0ce9ac71b60d","resolution":{"observed_at":"2026-08-07T00:27:00.949840Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2107.08398","last_updated":"2021-07-18T09:28:21Z","snapshot_observed_at":"2026-08-13T09:27:18.706968Z","submitted_at":"2021-07-18T09:28:21Z","title":"Unsupervised Skill-Discovery and Skill-Learning in Minecraft","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2107.08398","snapshot_observed_at":"2026-08-07T00:27:00.666160Z","title":"Unsupervised skill-discovery and skill-learning in minecraft,","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2506.14420","last_updated":"2025-06-17T11:30:04Z","snapshot_observed_at":"2026-08-09T18:22:45.556028Z","submitted_at":"2025-06-17T11:30:04Z","title":"Unsupervised Skill Discovery through Skill Regions Differentiation","version":1},"reference_index":49,"source":"pdf_text","source_observed_at":"2026-08-07T00:27:00.666160Z"},"links":{"cited_paper":"/paper/2107.08398","citing_paper":"/paper/2506.14420"},"observation_digest":"sha256:fa1a66c6dda6c47b758f8079b4d2601e01e43af6d5a36636c2d615f51ab17b8d","observation_id":"60d6b8f5-1755-43fa-be8b-c905890209f9","resolution":{"observed_at":"2026-08-07T00:27:00.666160Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T00:27:00.937250Z","title":"Rethinking mutual information for language conditioned skill discovery on imitation learning,","venue":null,"work_id":"c81c5801-954c-461f-bb1e-8b3031412f37","year":2024},"citing_paper":{"arxiv_id":"2506.14420","last_updated":"2025-06-17T11:30:04Z","snapshot_observed_at":"2026-08-09T18:22:45.556028Z","submitted_at":"2025-06-17T11:30:04Z","title":"Unsupervised Skill Discovery through Skill Regions Differentiation","version":1},"reference_index":50,"source":"pdf_text","source_observed_at":"2026-08-07T00:27:00.670115Z"},"links":{"citing_paper":"/paper/2506.14420"},"observation_digest":"sha256:d6b3b629b67b0cf4b316e21d3033aebfcf0c5360e0c78b1acb15d001f1cd2cab","observation_id":"0174ae71-1d5d-4b66-b325-c726bebd3b3a","resolution":{"observed_at":"2026-08-07T00:27:00.940307Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T00:27:00.927528Z","title":"Robust policy learning via offline skill diffusion,","venue":null,"work_id":"8963fa38-a66f-4c5c-9de3-99088bacd176","year":2024},"citing_paper":{"arxiv_id":"2506.14420","last_updated":"2025-06-17T11:30:04Z","snapshot_observed_at":"2026-08-09T18:22:45.556028Z","submitted_at":"2025-06-17T11:30:04Z","title":"Unsupervised Skill Discovery through Skill Regions Differentiation","version":1},"reference_index":51,"source":"pdf_text","source_observed_at":"2026-08-07T00:27:00.673501Z"},"links":{"citing_paper":"/paper/2506.14420"},"observation_digest":"sha256:189b2d0823ec6faff016ff7ee5b2677de1784d2bff95029d0f85b148301232fb","observation_id":"87d5dae8-0c73-47fd-adea-1a04ce1e5fd5","resolution":{"observed_at":"2026-08-07T00:27:00.930800Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T00:27:00.917185Z","title":"EUCLID: Towards efficient unsupervised reinforcement learning with multi-choice dynamics model,","venue":null,"work_id":"5a685ef4-7698-44aa-b26b-e3c8498f17a4","year":2023},"citing_paper":{"arxiv_id":"2506.14420","last_updated":"2025-06-17T11:30:04Z","snapshot_observed_at":"2026-08-09T18:22:45.556028Z","submitted_at":"2025-06-17T11:30:04Z","title":"Unsupervised Skill Discovery through Skill Regions Differentiation","version":1},"reference_index":52,"source":"pdf_text","source_observed_at":"2026-08-07T00:27:00.676484Z"},"links":{"citing_paper":"/paper/2506.14420"},"observation_digest":"sha256:ea80f188861aa2b8ba0f38d06f311aa8703a6dd8af8a83352be54126e0277138","observation_id":"532129b3-6699-4fdc-a237-47c38bbbd6c6","resolution":{"observed_at":"2026-08-07T00:27:00.920765Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2106.01404","last_updated":"2021-06-02T18:12:26Z","snapshot_observed_at":"2026-07-30T22:07:19.144088Z","submitted_at":"2021-06-02T18:12:26Z","title":"Variational Empowerment as Representation Learning for Goal-Based Reinforcement Learning","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2106.01404","snapshot_observed_at":"2026-08-07T00:27:00.680044Z","title":"Variational empowerment as representation learning for goal-based reinforcement learning,","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2506.14420","last_updated":"2025-06-17T11:30:04Z","snapshot_observed_at":"2026-08-09T18:22:45.556028Z","submitted_at":"2025-06-17T11:30:04Z","title":"Unsupervised Skill Discovery through Skill Regions Differentiation","version":1},"reference_index":53,"source":"pdf_text","source_observed_at":"2026-08-07T00:27:00.680044Z"},"links":{"cited_paper":"/paper/2106.01404","citing_paper":"/paper/2506.14420"},"observation_digest":"sha256:a9ff15f07c79475a3b611a94b4badb7cae9a5e977350a3379df279c6578e4567","observation_id":"9b7851eb-dfa8-4001-93cb-37191848cf60","resolution":{"observed_at":"2026-08-07T00:27:00.680044Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T00:27:00.906691Z","title":"Deep reinforcement learning at the edge of the statistical precipice,","venue":null,"work_id":"a49a3ca1-8156-448d-80f9-1e8e333bd43d","year":2021},"citing_paper":{"arxiv_id":"2506.14420","last_updated":"2025-06-17T11:30:04Z","snapshot_observed_at":"2026-08-09T18:22:45.556028Z","submitted_at":"2025-06-17T11:30:04Z","title":"Unsupervised Skill Discovery through Skill Regions Differentiation","version":1},"reference_index":54,"source":"pdf_text","source_observed_at":"2026-08-07T00:27:00.683746Z"},"links":{"citing_paper":"/paper/2506.14420"},"observation_digest":"sha256:c2e0b8e4494f751c498030e55b0482c79e8ad508a16ec4e99ff32549c8f7fe0b","observation_id":"c0d40dd6-4f94-410f-9d1e-31652ed883fa","resolution":{"observed_at":"2026-08-07T00:27:00.910096Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1801.00690","last_updated":"2018-01-02T15:48:14Z","snapshot_observed_at":"2026-08-01T20:24:08.300098Z","submitted_at":"2018-01-02T15:48:14Z","title":"DeepMind Control Suite","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1801.00690","snapshot_observed_at":"2026-08-07T00:27:00.688031Z","title":"Deepmind control suite,","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2506.14420","last_updated":"2025-06-17T11:30:04Z","snapshot_observed_at":"2026-08-09T18:22:45.556028Z","submitted_at":"2025-06-17T11:30:04Z","title":"Unsupervised Skill Discovery through Skill Regions Differentiation","version":1},"reference_index":55,"source":"pdf_text","source_observed_at":"2026-08-07T00:27:00.688031Z"},"links":{"cited_paper":"/paper/1801.00690","citing_paper":"/paper/2506.14420"},"observation_digest":"sha256:87921eccc562922e28274e93358766757e33e8c57d0b297c4876f2f36c54b0da","observation_id":"66b480bf-5b9a-445a-93bd-0ddbd0d3441a","resolution":{"observed_at":"2026-08-07T00:27:00.688031Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1509.02971","last_updated":"2019-07-05T10:47:27Z","snapshot_observed_at":"2026-07-06T04:29:24.362640Z","submitted_at":"2015-09-09T23:01:36Z","title":"Continuous control with deep reinforcement learning","version":6},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1509.02971","snapshot_observed_at":"2026-08-07T00:27:00.691720Z","title":"Continuous control with deep reinforcement learning","venue":null,"work_id":null,"year":2016},"citing_paper":{"arxiv_id":"2506.14420","last_updated":"2025-06-17T11:30:04Z","snapshot_observed_at":"2026-08-09T18:22:45.556028Z","submitted_at":"2025-06-17T11:30:04Z","title":"Unsupervised Skill Discovery through Skill Regions Differentiation","version":1},"reference_index":56,"source":"pdf_text","source_observed_at":"2026-08-07T00:27:00.691720Z"},"links":{"cited_paper":"/paper/1509.02971","citing_paper":"/paper/2506.14420"},"observation_digest":"sha256:87b45008456ca1f927dbd10cc2b255de92fb3d1fc38949f88c467640f64deff0","observation_id":"a9f30ed3-f669-4d5f-b7d8-e7b1c2a40bed","resolution":{"observed_at":"2026-08-07T00:27:00.691720Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T00:27:00.897087Z","title":"Mastering visual continuous control: Improved data-augmented reinforcement learning,","venue":null,"work_id":"422e834f-a159-4f59-aa90-fc7c05fd16e8","year":2022},"citing_paper":{"arxiv_id":"2506.14420","last_updated":"2025-06-17T11:30:04Z","snapshot_observed_at":"2026-08-09T18:22:45.556028Z","submitted_at":"2025-06-17T11:30:04Z","title":"Unsupervised Skill Discovery through Skill Regions Differentiation","version":1},"reference_index":57,"source":"pdf_text","source_observed_at":"2026-08-07T00:27:00.695397Z"},"links":{"citing_paper":"/paper/2506.14420"},"observation_digest":"sha256:96581e2710486bf691cfd86f0f31b4931c6a677d1c8f110d69c99645ec68a015","observation_id":"938e136d-270b-44d4-879d-efd40bcb47a9","resolution":{"observed_at":"2026-08-07T00:27:00.900348Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T00:27:00.887521Z","title":"Mastering atari with discrete world models,","venue":null,"work_id":"60120aa8-c755-493c-8750-6f6e886222bf","year":2021},"citing_paper":{"arxiv_id":"2506.14420","last_updated":"2025-06-17T11:30:04Z","snapshot_observed_at":"2026-08-09T18:22:45.556028Z","submitted_at":"2025-06-17T11:30:04Z","title":"Unsupervised Skill Discovery through Skill Regions Differentiation","version":1},"reference_index":58,"source":"pdf_text","source_observed_at":"2026-08-07T00:27:00.699020Z"},"links":{"citing_paper":"/paper/2506.14420"},"observation_digest":"sha256:43527e2f8a39653ed398b843dbdf14e8b33bfaf8778fc34b7b25ce54125b9c02","observation_id":"c14da304-2640-44aa-a0a0-67dbafd95f84","resolution":{"observed_at":"2026-08-07T00:27:00.890594Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T00:27:00.877895Z","title":"Provably efficient rein- forcement learning with linear function approximation,","venue":null,"work_id":"197a00aa-adf2-41f1-a4e9-f39837c4587d","year":2023},"citing_paper":{"arxiv_id":"2506.14420","last_updated":"2025-06-17T11:30:04Z","snapshot_observed_at":"2026-08-09T18:22:45.556028Z","submitted_at":"2025-06-17T11:30:04Z","title":"Unsupervised Skill Discovery through Skill Regions Differentiation","version":1},"reference_index":59,"source":"pdf_text","source_observed_at":"2026-08-07T00:27:00.702736Z"},"links":{"citing_paper":"/paper/2506.14420"},"observation_digest":"sha256:38428784892900292f20cd18748b45024376039c0e36cb3bcfe7ddf1680b0cd2","observation_id":"05d9e23b-2958-4fc4-b1d1-809d2a638e31","resolution":{"observed_at":"2026-08-07T00:27:00.880897Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T00:27:00.868103Z","title":"Reward-free model-based reinforcement learning with linear function approximation,","venue":null,"work_id":"52fa8217-54b4-496a-96e5-f19f5e602d06","year":2021},"citing_paper":{"arxiv_id":"2506.14420","last_updated":"2025-06-17T11:30:04Z","snapshot_observed_at":"2026-08-09T18:22:45.556028Z","submitted_at":"2025-06-17T11:30:04Z","title":"Unsupervised Skill Discovery through Skill Regions Differentiation","version":1},"reference_index":60,"source":"pdf_text","source_observed_at":"2026-08-07T00:27:00.707318Z"},"links":{"citing_paper":"/paper/2506.14420"},"observation_digest":"sha256:2b448f673ec7f99316e89062e9ddef74d69577902b940959f6141d4e0975d1c4","observation_id":"cf051aba-497b-4290-b167-116d05c26cdd","resolution":{"observed_at":"2026-08-07T00:27:00.871448Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T00:27:00.711258Z","title":"Deep variational information bottleneck,","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2506.14420","last_updated":"2025-06-17T11:30:04Z","snapshot_observed_at":"2026-08-09T18:22:45.556028Z","submitted_at":"2025-06-17T11:30:04Z","title":"Unsupervised Skill Discovery through Skill Regions Differentiation","version":1},"reference_index":61,"source":"pdf_text","source_observed_at":"2026-08-07T00:27:00.711258Z"},"links":{"citing_paper":"/paper/2506.14420"},"observation_digest":"sha256:807a17909caf15584fd8d95715851e0a02e7bd402025189ca3ad1e59d5cec4a5","observation_id":"ae0bbdbe-c31f-4a3d-8441-e11393c504ed","resolution":{"observed_at":"2026-08-07T00:27:00.711258Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T00:27:00.851005Z","title":"Dynamic bottleneck for robust self-supervised exploration,","venue":null,"work_id":"2309e31d-0e02-4ecb-90ab-97308e8e5899","year":2021},"citing_paper":{"arxiv_id":"2506.14420","last_updated":"2025-06-17T11:30:04Z","snapshot_observed_at":"2026-08-09T18:22:45.556028Z","submitted_at":"2025-06-17T11:30:04Z","title":"Unsupervised Skill Discovery through Skill Regions Differentiation","version":1},"reference_index":62,"source":"pdf_text","source_observed_at":"2026-08-07T00:27:00.715141Z"},"links":{"citing_paper":"/paper/2506.14420"},"observation_digest":"sha256:10ab1f7e2065533dff849456f050f730b3a97468f460bcbb6be172cae38c9e22","observation_id":"66625992-49c9-4b03-abe3-5d4fee27eec8","resolution":{"observed_at":"2026-08-07T00:27:00.854381Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T00:27:00.840654Z","title":"Provably efficient exploration in policy optimization,","venue":null,"work_id":"491b6da2-f917-42ed-b5e5-dc866672c20a","year":2020},"citing_paper":{"arxiv_id":"2506.14420","last_updated":"2025-06-17T11:30:04Z","snapshot_observed_at":"2026-08-09T18:22:45.556028Z","submitted_at":"2025-06-17T11:30:04Z","title":"Unsupervised Skill Discovery through Skill Regions Differentiation","version":1},"reference_index":63,"source":"pdf_text","source_observed_at":"2026-08-07T00:27:00.718687Z"},"links":{"citing_paper":"/paper/2506.14420"},"observation_digest":"sha256:997536036534a5224c2a0cd0a8a9f1fcd6d18fe4c6e7d0e02dda9364efd45462","observation_id":"17e3e0cf-fcfd-4ab5-a163-7e6f6baa304e","resolution":{"observed_at":"2026-08-07T00:27:00.844208Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T00:27:00.827260Z","title":"Logarithmic online regret bounds for undis- counted reinforcement learning,","venue":null,"work_id":"d35d6587-5076-45f1-a95c-1e6ceee6bdad","year":2006},"citing_paper":{"arxiv_id":"2506.14420","last_updated":"2025-06-17T11:30:04Z","snapshot_observed_at":"2026-08-09T18:22:45.556028Z","submitted_at":"2025-06-17T11:30:04Z","title":"Unsupervised Skill Discovery through Skill Regions Differentiation","version":1},"reference_index":64,"source":"pdf_text","source_observed_at":"2026-08-07T00:27:00.722538Z"},"links":{"citing_paper":"/paper/2506.14420"},"observation_digest":"sha256:c80ce78026cc107362690f8a9a415b33ab237fec544443eb3088092dc067dddf","observation_id":"d95da145-63a3-467a-88a2-5c8a91764329","resolution":{"observed_at":"2026-08-07T00:27:00.832856Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T00:27:01.005153Z","title":"Available: https://openreview.net/forum?id=Hkla1eHFvS","venue":null,"work_id":"641f9d25-c863-4b56-a5f8-9eb740d6b39f","year":null},"citing_paper":{"arxiv_id":"2506.14420","last_updated":"2025-06-17T11:30:04Z","snapshot_observed_at":"2026-08-09T18:22:45.556028Z","submitted_at":"2025-06-17T11:30:04Z","title":"Unsupervised Skill Discovery through Skill Regions Differentiation","version":1},"reference_index":2020,"source":"pdf_text","source_observed_at":"2026-08-07T00:27:00.640914Z"},"links":{"citing_paper":"/paper/2506.14420"},"observation_digest":"sha256:7f8747e7edc2bb0ae6a5f739f27d4e4a210507f109c74efa3a51455fc62baa52","observation_id":"591aa826-3252-4443-a02e-6acff41e581c","resolution":{"observed_at":"2026-08-07T00:27:01.008510Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}}],"paper":{"arxiv_id":"2506.14420","last_updated":"2025-06-17T11:30:04Z","latest_version":1,"primary_category":"cs.LG","snapshot_observed_at":"2026-08-09T18:22:45.556028Z","submitted_at":"2025-06-17T11:30:04Z","title":"Unsupervised Skill Discovery through Skill Regions Differentiation"},"reference_resolution":{"displayed":65,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":16,"verified_exact":0,"verified_fuzzy":49},"total_outbound_references":65},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"thesis":"As of 14 August 2026, this Paper Citation Record lists 65 of 65 outbound references and 0 inbound Pith citation observations for arXiv:2506.14420."}