{"as_of":"2026-08-09T19:09:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:f584379965636d2605391690c9079d9a04e04b39f3d1f7941f107c222b6adc59","coverage":[{"denominator":15,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":15,"source":"paper_references, paper_reference_links","source_observed_at":"2026-07-13T17:19:02.982053Z","state":"measured"},{"denominator":16,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":16,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-09T06:31:02.800959+00:00","state":"measured"},{"denominator":1,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":1,"source":"paper_references, paper_reference_links","source_observed_at":"2026-06-27T10:27:47.896922Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"arxiv_reference","source_observed_at":"2026-07-03T09:17:48.486940Z","state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2603.27044","last_updated":"2026-07-05T10:41:38Z","snapshot_observed_at":"2026-08-09T09:19:42.540736Z","submitted_at":"2026-03-27T23:16:27Z","title":"Unsupervised Behavioral Compression: Learning Low-Dimensional Policy Manifolds through State-Occupancy Matching","version":3},"cited_work":{"arxiv_id":"2603.27044","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2603.27044","snapshot_observed_at":"2026-07-07T03:18:14.563422Z","title":"arXiv preprint arXiv:2603.27044 , year=","venue":null,"work_id":"17539d64-168f-4804-b4c9-bb2d4649a48d","year":null},"citing_paper":{"arxiv_id":"2606.12200","last_updated":"2026-06-10T15:19:41Z","snapshot_observed_at":"2026-07-06T23:51:07.629939Z","submitted_at":"2026-06-10T15:19:41Z","title":"Implicit Neural Representations of Individual Behavior","version":1},"reference_index":99,"source":"arxiv_source","source_observed_at":"2026-06-27T10:27:47.896922Z"},"links":{"cited_paper":"/paper/2603.27044","citing_paper":"/paper/2606.12200"},"observation_digest":"sha256:23364081070f57b50e1de0818233468e38611c0fe4356938f5e51ce8e4e3162c","observation_id":"068c1dd5-793c-4edf-aa67-363193e9e106","resolution":{"observed_at":"2026-07-07T03:18:14.563422Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}}],"links":{"evidence":"/evidence","html":"/paper/2603.27044/citation-record","integrity":"/paper/2603.27044/integrity","json":"/paper/2603.27044/citation-record.json","paper":"/paper/2603.27044"},"outbound":[{"citation":{"cited_paper":{"arxiv_id":"1807.10299","last_updated":"2018-07-26T18:05:45Z","snapshot_observed_at":"2026-07-06T06:52:34.374453Z","submitted_at":"2018-07-26T18:05:45Z","title":"Variational Option Discovery Algorithms","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1807.10299","snapshot_observed_at":"2026-07-13T17:19:02.982053Z","title":"Variational option discovery algorithms.arXiv preprint arXiv:1807.10299,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2603.27044","last_updated":"2026-07-05T10:41:38Z","snapshot_observed_at":"2026-08-09T09:19:42.540736Z","submitted_at":"2026-03-27T23:16:27Z","title":"Unsupervised Behavioral Compression: Learning Low-Dimensional Policy Manifolds through State-Occupancy Matching","version":3},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-07-13T17:19:02.982053Z"},"links":{"cited_paper":"/paper/1807.10299","citing_paper":"/paper/2603.27044"},"observation_digest":"sha256:1ee2d58682e0bfc13bd5e71e63ce3bcde29cf9466fa7da34234cb00d81afeaa8","observation_id":"c6f2957b-b364-48a5-898e-e78144beab08","resolution":{"observed_at":"2026-07-13T17:19:02.982053Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-13T17:19:02.982053Z","title":"Learning policy representations for steerable behavior synthesis.arXiv preprint arXiv:2601.22350,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2603.27044","last_updated":"2026-07-05T10:41:38Z","snapshot_observed_at":"2026-08-09T09:19:42.540736Z","submitted_at":"2026-03-27T23:16:27Z","title":"Unsupervised Behavioral Compression: Learning Low-Dimensional Policy Manifolds through State-Occupancy Matching","version":3},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-07-13T17:19:02.982053Z"},"links":{"citing_paper":"/paper/2603.27044"},"observation_digest":"sha256:acfbabdf6cc36517640d17b74d20e00472e3d1c99766bb4f52dc0b43a86dca12","observation_id":"0330c2a1-e371-4af3-bd20-6cb4fb262cb0","resolution":{"observed_at":"2026-07-13T17:19:02.982053Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":"10.1609/aaai.v35i10.17091","metadata_source":"openalex","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Mirco Mutti, Stefano Del Col, and Marcello Restelli","venue":"Proceedings of the AAAI Conference on Artificial Intelligence","work_id":"22a9f6f1-5af1-4279-aa2b-172e2019f4b9","year":null},"citing_paper":{"arxiv_id":"2603.27044","last_updated":"2026-07-05T10:41:38Z","snapshot_observed_at":"2026-08-09T09:19:42.540736Z","submitted_at":"2026-03-27T23:16:27Z","title":"Unsupervised Behavioral Compression: Learning Low-Dimensional Policy Manifolds through State-Occupancy Matching","version":3},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-07-13T17:19:02.982053Z"},"links":{"citing_paper":"/paper/2603.27044"},"observation_digest":"sha256:15c7393b0ff09c5e263b6e395086ea8dd97681d9c8936c289029fceba6c9142b","observation_id":"f812df9f-ea7e-4330-9a72-71f35508d3b0","resolution":{"observed_at":"2026-07-13T17:19:46.580425Z","resolver_source":"doi","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2209.12892","last_updated":"2022-09-26T17:59:58Z","snapshot_observed_at":"2026-08-08T07:16:34.088459Z","submitted_at":"2022-09-26T17:59:58Z","title":"Learning to Learn with Generative Models of Neural Network Checkpoints","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2209.12892","snapshot_observed_at":"2026-07-13T17:19:02.982053Z","title":"Learning to learn with generative models of neural network checkpoints.arXiv preprint arXiv:2209.12892,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2603.27044","last_updated":"2026-07-05T10:41:38Z","snapshot_observed_at":"2026-08-09T09:19:42.540736Z","submitted_at":"2026-03-27T23:16:27Z","title":"Unsupervised Behavioral Compression: Learning Low-Dimensional Policy Manifolds through State-Occupancy Matching","version":3},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-07-13T17:19:02.982053Z"},"links":{"cited_paper":"/paper/2209.12892","citing_paper":"/paper/2603.27044"},"observation_digest":"sha256:6255f44e9d33bce96ea1a8bb924153534ff2dc9c7e44ed322a7496e2b0c98d8f","observation_id":"ca27d3bb-591e-47ae-bfde-499053712d75","resolution":{"observed_at":"2026-07-13T17:19:02.982053Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1707.06347","last_updated":"2017-08-28T09:20:06Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2017-07-20T02:32:33Z","title":"Proximal Policy Optimization Algorithms","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1707.06347","snapshot_observed_at":"2026-07-13T17:19:02.982053Z","title":"Proximal policy optimization algorithms.arXiv preprint arXiv:1707.06347,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2603.27044","last_updated":"2026-07-05T10:41:38Z","snapshot_observed_at":"2026-08-09T09:19:42.540736Z","submitted_at":"2026-03-27T23:16:27Z","title":"Unsupervised Behavioral Compression: Learning Low-Dimensional Policy Manifolds through State-Occupancy Matching","version":3},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-07-13T17:19:02.982053Z"},"links":{"cited_paper":"/paper/1707.06347","citing_paper":"/paper/2603.27044"},"observation_digest":"sha256:3bd35e6d4bd66a78eaef65894727653606713912f53c7e2f1aa32a4a5fd301a4","observation_id":"92533859-3fc2-4755-b603-cfdd1cd6c4ad","resolution":{"observed_at":"2026-07-13T17:19:02.982053Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"9620.2020","doi":"10.1109/ddcls49620.2020.9275169","metadata_source":"arxiv_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"11 Supplementary Materials The following content was not necessarily subject to peer review","venue":"2020 IEEE 9th Data Driven Control and Learning Systems Conference (DDCLS)","work_id":"3866e6a3-94ea-40e4-975b-d6ce3c930c5e","year":2020},"citing_paper":{"arxiv_id":"2603.27044","last_updated":"2026-07-05T10:41:38Z","snapshot_observed_at":"2026-08-09T09:19:42.540736Z","submitted_at":"2026-03-27T23:16:27Z","title":"Unsupervised Behavioral Compression: Learning Low-Dimensional Policy Manifolds through State-Occupancy Matching","version":3},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-07-13T17:19:02.982053Z"},"links":{"citing_paper":"/paper/2603.27044"},"observation_digest":"sha256:ad7c451e88b511499b74ac0841365fa77a1a6d38019beb26578f11eb46c5280d","observation_id":"88fa4cd6-1d89-48e4-b752-77dd7d5ad0b9","resolution":{"observed_at":"2026-07-13T17:19:46.588097Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-13T17:19:02.982053Z","title":"In supervised learning, hyper-representations(Schürholt et al., 2021; 2022","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2603.27044","last_updated":"2026-07-05T10:41:38Z","snapshot_observed_at":"2026-08-09T09:19:42.540736Z","submitted_at":"2026-03-27T23:16:27Z","title":"Unsupervised Behavioral Compression: Learning Low-Dimensional Policy Manifolds through State-Occupancy Matching","version":3},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-07-13T17:19:02.982053Z"},"links":{"citing_paper":"/paper/2603.27044"},"observation_digest":"sha256:81f2e146360e917c77ab19e1d11a6acbe5b47f4ae8b79ff81f47befdb7506459","observation_id":"f2d34d48-87ea-4a6b-8c80-e8a6f2c7a393","resolution":{"observed_at":"2026-07-13T17:19:02.982053Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-13T17:19:02.982053Z","title":"To circumvent this, recent works in supervised learning supplement standard parameter reconstruction losses with behavioral output matching (Meynent et al., 2025)","venue":null,"work_id":null,"year":1994},"citing_paper":{"arxiv_id":"2603.27044","last_updated":"2026-07-05T10:41:38Z","snapshot_observed_at":"2026-08-09T09:19:42.540736Z","submitted_at":"2026-03-27T23:16:27Z","title":"Unsupervised Behavioral Compression: Learning Low-Dimensional Policy Manifolds through State-Occupancy Matching","version":3},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-07-13T17:19:02.982053Z"},"links":{"citing_paper":"/paper/2603.27044"},"observation_digest":"sha256:8faaf0e6b157fee51acbf5ea7558afbce0f4cf13cf2749fd726426b147f608ce","observation_id":"ac37e8c2-3056-48c6-bdf2-8a9e20dda9d0","resolution":{"observed_at":"2026-07-13T17:19:02.982053Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-13T17:19:02.982053Z","title":"Similar architectures have been applied in Quality Diversity to improve the sample efficiency of diversity-based search (Rakicevic et al.,","venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2603.27044","last_updated":"2026-07-05T10:41:38Z","snapshot_observed_at":"2026-08-09T09:19:42.540736Z","submitted_at":"2026-03-27T23:16:27Z","title":"Unsupervised Behavioral Compression: Learning Low-Dimensional Policy Manifolds through State-Occupancy Matching","version":3},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-07-13T17:19:02.982053Z"},"links":{"citing_paper":"/paper/2603.27044"},"observation_digest":"sha256:1db814a04e823e508309d114abe5ad9f470288560c0653963b0bf83db1544d78","observation_id":"1d6f86ff-f04d-42fa-9052-1d4c3b63b889","resolution":{"observed_at":"2026-07-13T17:19:02.982053Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-13T17:19:02.982053Z","title":"Notably, these methods rely onparameter-reconstruction losses, which fundamentally restrict their compression ratios (e.g., up to 19 : 1 in Hegde et al","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2603.27044","last_updated":"2026-07-05T10:41:38Z","snapshot_observed_at":"2026-08-09T09:19:42.540736Z","submitted_at":"2026-03-27T23:16:27Z","title":"Unsupervised Behavioral Compression: Learning Low-Dimensional Policy Manifolds through State-Occupancy Matching","version":3},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-07-13T17:19:02.982053Z"},"links":{"citing_paper":"/paper/2603.27044"},"observation_digest":"sha256:b309f8cdc7c049126d24297a2c21615688d91d7b74590ecb41f1f1585a69adf5","observation_id":"39f8e67d-daa9-4265-8785-bacdee8dd9df","resolution":{"observed_at":"2026-07-13T17:19:02.982053Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-13T17:19:02.982053Z","title":null,"venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2603.27044","last_updated":"2026-07-05T10:41:38Z","snapshot_observed_at":"2026-08-09T09:19:42.540736Z","submitted_at":"2026-03-27T23:16:27Z","title":"Unsupervised Behavioral Compression: Learning Low-Dimensional Policy Manifolds through State-Occupancy Matching","version":3},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-07-13T17:19:02.982053Z"},"links":{"citing_paper":"/paper/2603.27044"},"observation_digest":"sha256:d73404bacc48653052d4ac5431cb28566e97c96cabacbc4d2f0fbaf864d084b9","observation_id":"ecaca591-6f3c-4726-ba4c-ce03679ce71d","resolution":{"observed_at":"2026-07-13T17:19:02.982053Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-13T17:19:02.982053Z","title":"Our contribution scales these concepts from single-expert matching to population-level alignment by developing a mixture-occupancy matching objective","venue":null,"work_id":null,"year":2008},"citing_paper":{"arxiv_id":"2603.27044","last_updated":"2026-07-05T10:41:38Z","snapshot_observed_at":"2026-08-09T09:19:42.540736Z","submitted_at":"2026-03-27T23:16:27Z","title":"Unsupervised Behavioral Compression: Learning Low-Dimensional Policy Manifolds through State-Occupancy Matching","version":3},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-07-13T17:19:02.982053Z"},"links":{"citing_paper":"/paper/2603.27044"},"observation_digest":"sha256:03072f6e616cb1cd38760c722150da717602ec44773549cb995d2ea1135136b1","observation_id":"8018d7ca-3319-4b25-9668-26cebbd90ce7","resolution":{"observed_at":"2026-07-13T17:19:02.982053Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-13T17:19:02.982053Z","title":null,"venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2603.27044","last_updated":"2026-07-05T10:41:38Z","snapshot_observed_at":"2026-08-09T09:19:42.540736Z","submitted_at":"2026-03-27T23:16:27Z","title":"Unsupervised Behavioral Compression: Learning Low-Dimensional Policy Manifolds through State-Occupancy Matching","version":3},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-07-13T17:19:02.982053Z"},"links":{"citing_paper":"/paper/2603.27044"},"observation_digest":"sha256:3767865339b7d735117292516db9f7c14368f27d2e0831bb37c5d58c7b87e9b9","observation_id":"a323aede-a36a-4f31-ac88-5b01ff0ced6a","resolution":{"observed_at":"2026-07-13T17:19:02.982053Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-13T17:19:02.982053Z","title":"Proof.By the definition of the mixture, m(x) =w ipi(x)+P j̸=i wjpj(x)","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2603.27044","last_updated":"2026-07-05T10:41:38Z","snapshot_observed_at":"2026-08-09T09:19:42.540736Z","submitted_at":"2026-03-27T23:16:27Z","title":"Unsupervised Behavioral Compression: Learning Low-Dimensional Policy Manifolds through State-Occupancy Matching","version":3},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-07-13T17:19:02.982053Z"},"links":{"citing_paper":"/paper/2603.27044"},"observation_digest":"sha256:c847f01198981defb8c93f258c72688e07e3fc784cd7ac12c024dec6cf0b15b8","observation_id":"3fac1c43-d117-4862-b2a8-714a13a148db","resolution":{"observed_at":"2026-07-13T17:19:02.982053Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-13T17:19:02.982053Z","title":"Reacher (RC).RC features a two-jointed robotic arm moving in a 2D plane","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2603.27044","last_updated":"2026-07-05T10:41:38Z","snapshot_observed_at":"2026-08-09T09:19:42.540736Z","submitted_at":"2026-03-27T23:16:27Z","title":"Unsupervised Behavioral Compression: Learning Low-Dimensional Policy Manifolds through State-Occupancy Matching","version":3},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-07-13T17:19:02.982053Z"},"links":{"citing_paper":"/paper/2603.27044"},"observation_digest":"sha256:99547df598c1a2b9a79d8e4b9e0a3633061b6e7df68bfd7f22a07450ac516f5e","observation_id":"36a663ca-7f4d-488a-842d-7dced679c0e9","resolution":{"observed_at":"2026-07-13T17:19:02.982053Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"paper":{"arxiv_id":"2603.27044","last_updated":"2026-07-05T10:41:38Z","latest_version":3,"primary_category":"cs.LG","snapshot_observed_at":"2026-08-09T09:19:42.540736Z","submitted_at":"2026-03-27T23:16:27Z","title":"Unsupervised Behavioral Compression: Learning Low-Dimensional Policy Manifolds through State-Occupancy Matching"},"reference_resolution":{"displayed":15,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":13,"verified_exact":2,"verified_fuzzy":0},"total_outbound_references":15},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"thesis":"As of 9 August 2026, this Paper Citation Record lists 15 of 15 outbound references and 1 inbound Pith citation observation for arXiv:2603.27044."}