{"as_of":"2026-08-12T18:01:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:0b8894e9905cfe42638ea7f47573c7ad6430ebf713af6c6b3a68693bad447ff8","coverage":[{"denominator":13,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":13,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-07T05:01:02.986353Z","state":"measured"},{"denominator":15,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":15,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-12T06:34:41.77262+00:00","state":"measured"},{"denominator":2,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":2,"source":"paper_references, paper_reference_links","source_observed_at":"2026-06-27T10:27:47.896922Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"arxiv_reference","source_observed_at":"2026-07-04T17:20:00.517702Z","state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2506.09202","last_updated":"2025-06-12T03:14:40Z","snapshot_observed_at":"2026-08-09T14:46:08.724220Z","submitted_at":"2025-06-10T19:44:48Z","title":"Policy-Based Trajectory Clustering in Offline Reinforcement Learning","version":2},"cited_work":{"arxiv_id":"2506.09202","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2506.09202","snapshot_observed_at":"2026-07-04T17:20:00.517702Z","title":"Policy-based trajectory clustering in offline reinforce- ment learning","venue":null,"work_id":"db1bb90a-8403-444a-a953-45d7b2f48e9f","year":null},"citing_paper":{"arxiv_id":"2606.12200","last_updated":"2026-06-10T15:19:41Z","snapshot_observed_at":"2026-07-06T23:51:07.629939Z","submitted_at":"2026-06-10T15:19:41Z","title":"Implicit Neural Representations of Individual Behavior","version":1},"reference_index":92,"source":"arxiv_source","source_observed_at":"2026-06-27T10:27:47.896922Z"},"links":{"cited_paper":"/paper/2506.09202","citing_paper":"/paper/2606.12200"},"observation_digest":"sha256:a39d7429625db40aad30d12cd8b1ce03057f4595669a9c3d7860c860e8265df9","observation_id":"513d2eda-a545-4fcd-b8e7-42e07391a589","resolution":{"observed_at":"2026-07-03T09:17:48.435994Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2506.09202","last_updated":"2025-06-12T03:14:40Z","snapshot_observed_at":"2026-08-09T14:46:08.724220Z","submitted_at":"2025-06-10T19:44:48Z","title":"Policy-Based Trajectory Clustering in Offline Reinforcement Learning","version":2},"cited_work":{"arxiv_id":"2506.09202","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2506.09202","snapshot_observed_at":"2026-07-04T17:20:00.517702Z","title":"Policy-based trajectory clustering in offline reinforce- ment learning","venue":null,"work_id":"db1bb90a-8403-444a-a953-45d7b2f48e9f","year":null},"citing_paper":{"arxiv_id":"2606.24601","last_updated":"2026-06-23T14:03:36Z","snapshot_observed_at":"2026-08-07T01:04:52.748978Z","submitted_at":"2026-06-23T14:03:36Z","title":"ASALT: Adaptive State Alignment for Lateral Transfer in Multi-agent Reinforcement Learning","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-06-25T23:46:50.183064Z"},"links":{"cited_paper":"/paper/2506.09202","citing_paper":"/paper/2606.24601"},"observation_digest":"sha256:1ced1e2da6228796cb12745ee533ba451fd0e78ff1f6ee6a92ba584853292abb","observation_id":"7aa0886d-e7c1-4479-8a86-934233ff7c8d","resolution":{"observed_at":"2026-07-04T17:20:00.519286Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}}],"links":{"evidence":"/evidence","html":"/paper/2506.09202/citation-record","integrity":"/paper/2506.09202/integrity","json":"/paper/2506.09202/citation-record.json","paper":"/paper/2506.09202"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:01:03.296203Z","title":null,"venue":null,"work_id":"07be56c3-7f6a-461c-92fd-37c9e14b5ab5","year":null},"citing_paper":{"arxiv_id":"2506.09202","last_updated":"2025-06-12T03:14:40Z","snapshot_observed_at":"2026-08-09T14:46:08.724220Z","submitted_at":"2025-06-10T19:44:48Z","title":"Policy-Based Trajectory Clustering in Offline Reinforcement Learning","version":2},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-07T05:01:02.962537Z"},"links":{"citing_paper":"/paper/2506.09202"},"observation_digest":"sha256:d4bcc33ac4e66462a5dd6a35832199b8c38440615ec71f8af16332a0d2b3cb9f","observation_id":"c47bc253-0561-4887-8529-9a3809064937","resolution":{"observed_at":"2026-08-07T05:01:03.300603Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:01:03.282078Z","title":null,"venue":null,"work_id":"affea8da-bf0b-4bb3-b408-92be591eba7f","year":null},"citing_paper":{"arxiv_id":"2506.09202","last_updated":"2025-06-12T03:14:40Z","snapshot_observed_at":"2026-08-09T14:46:08.724220Z","submitted_at":"2025-06-10T19:44:48Z","title":"Policy-Based Trajectory Clustering in Offline Reinforcement Learning","version":2},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-07T05:01:02.966492Z"},"links":{"citing_paper":"/paper/2506.09202"},"observation_digest":"sha256:8348df52923c1d2f0a20c824a09bf4410859b7a60a7b9dcd2158d8af47041311","observation_id":"e1c511b1-b97e-4a24-ac76-3583315dfd99","resolution":{"observed_at":"2026-08-07T05:01:03.286204Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:01:03.266727Z","title":null,"venue":null,"work_id":"ddd8bfa7-f12a-4a54-9a84-a60c8f8c22c8","year":null},"citing_paper":{"arxiv_id":"2506.09202","last_updated":"2025-06-12T03:14:40Z","snapshot_observed_at":"2026-08-09T14:46:08.724220Z","submitted_at":"2025-06-10T19:44:48Z","title":"Policy-Based Trajectory Clustering in Offline Reinforcement Learning","version":2},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-07T05:01:02.970261Z"},"links":{"citing_paper":"/paper/2506.09202"},"observation_digest":"sha256:42b6ae3d7f9623d09c0ef64eba6fba203e3990e0ded6653ab0de5a5bed908783","observation_id":"379f1434-9361-4d59-8b59-4ccbd6333370","resolution":{"observed_at":"2026-08-07T05:01:03.271406Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:01:03.253029Z","title":null,"venue":null,"work_id":"6d25d56d-ce62-4ee9-a3f0-fa5b394716cc","year":null},"citing_paper":{"arxiv_id":"2506.09202","last_updated":"2025-06-12T03:14:40Z","snapshot_observed_at":"2026-08-09T14:46:08.724220Z","submitted_at":"2025-06-10T19:44:48Z","title":"Policy-Based Trajectory Clustering in Offline Reinforcement Learning","version":2},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-07T05:01:02.974127Z"},"links":{"citing_paper":"/paper/2506.09202"},"observation_digest":"sha256:94902fcd7db4637665221e784db8dc7bb650cda4ed9a1dcb8a27ad107fb0aeee","observation_id":"86f73a97-a64a-4d6b-9036-cd7c669c123f","resolution":{"observed_at":"2026-08-07T05:01:03.256975Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:01:03.239026Z","title":"Takeball There are four different rule-based policies, i-th policy will pick the i-th ball first","venue":null,"work_id":"f723aafb-c1b7-4385-b776-b51f5eca7f55","year":null},"citing_paper":{"arxiv_id":"2506.09202","last_updated":"2025-06-12T03:14:40Z","snapshot_observed_at":"2026-08-09T14:46:08.724220Z","submitted_at":"2025-06-10T19:44:48Z","title":"Policy-Based Trajectory Clustering in Offline Reinforcement Learning","version":2},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-07T05:01:02.977885Z"},"links":{"citing_paper":"/paper/2506.09202"},"observation_digest":"sha256:c7052fe3db3962fb37d9e9cbbae5e2d74e7c9320b9826f7f12df6604b64ca2c6","observation_id":"9c94e70c-2d7b-46da-b108-9da3b240bee5","resolution":{"observed_at":"2026-08-07T05:01:03.243513Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:01:03.225273Z","title":null,"venue":null,"work_id":"039806bf-e855-4d6d-9cc7-cd5ff6687a85","year":null},"citing_paper":{"arxiv_id":"2506.09202","last_updated":"2025-06-12T03:14:40Z","snapshot_observed_at":"2026-08-09T14:46:08.724220Z","submitted_at":"2025-06-10T19:44:48Z","title":"Policy-Based Trajectory Clustering in Offline Reinforcement Learning","version":2},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-07T05:01:02.981668Z"},"links":{"citing_paper":"/paper/2506.09202"},"observation_digest":"sha256:dc9035e690ef6ea3a1ab311c3898540ba074e14204aab23c6400efb63be347c4","observation_id":"2cadc6d3-6a9d-4f48-83b9-e7a07950a58f","resolution":{"observed_at":"2026-08-07T05:01:03.229272Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:01:03.211250Z","title":"These policies are corresponding to: No preference, prefer to go up first and prefer to go right first","venue":null,"work_id":"aa6fa73f-70dc-4cbf-93e9-42e484e89481","year":2016},"citing_paper":{"arxiv_id":"2506.09202","last_updated":"2025-06-12T03:14:40Z","snapshot_observed_at":"2026-08-09T14:46:08.724220Z","submitted_at":"2025-06-10T19:44:48Z","title":"Policy-Based Trajectory Clustering in Offline Reinforcement Learning","version":2},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-07T05:01:02.986353Z"},"links":{"citing_paper":"/paper/2506.09202"},"observation_digest":"sha256:0883db74bedfcf3b568e1cd275843166f2a5e0642ba185df70eef846ec28e0b8","observation_id":"adb002fe-3f00-4860-a89e-3e72b48120bc","resolution":{"observed_at":"2026-08-07T05:01:03.215458Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1511.06335","last_updated":"2016-05-24T22:27:35Z","snapshot_observed_at":"2026-08-09T14:46:10.795211Z","submitted_at":"2015-11-19T20:06:14Z","title":"Unsupervised Deep Embedding for Clustering Analysis","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1511.06335","snapshot_observed_at":"2026-08-07T05:01:02.957217Z","title":"distance","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2506.09202","last_updated":"2025-06-12T03:14:40Z","snapshot_observed_at":"2026-08-09T14:46:08.724220Z","submitted_at":"2025-06-10T19:44:48Z","title":"Policy-Based Trajectory Clustering in Offline Reinforcement Learning","version":2},"reference_index":2016,"source":"pdf_text","source_observed_at":"2026-08-07T05:01:02.957217Z"},"links":{"cited_paper":"/paper/1511.06335","citing_paper":"/paper/2506.09202"},"observation_digest":"sha256:e6d12c3d4ec392c4246d524f2b3b39c8fc1767de52f83f5614a5e8f97fd07845","observation_id":"d36b757d-f311-4590-ad1b-b9c86dbe2772","resolution":{"observed_at":"2026-08-07T05:01:02.957217Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1911.11361","last_updated":"2019-11-26T06:11:34Z","snapshot_observed_at":"2026-08-12T13:17:36.653110Z","submitted_at":"2019-11-26T06:11:34Z","title":"Behavior Regularized Offline Reinforcement Learning","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1911.11361","snapshot_observed_at":"2026-08-07T05:01:02.952757Z","title":"Junyuan Xie, Ross Girshick, and Ali Farhadi","venue":null,"work_id":null,"year":1911},"citing_paper":{"arxiv_id":"2506.09202","last_updated":"2025-06-12T03:14:40Z","snapshot_observed_at":"2026-08-09T14:46:08.724220Z","submitted_at":"2025-06-10T19:44:48Z","title":"Policy-Based Trajectory Clustering in Offline Reinforcement Learning","version":2},"reference_index":2019,"source":"pdf_text","source_observed_at":"2026-08-07T05:01:02.952757Z"},"links":{"cited_paper":"/paper/1911.11361","citing_paper":"/paper/2506.09202"},"observation_digest":"sha256:d48a0a560cb80270ee70af7e7990f44ea7ca34e4604938890859337e9fe625ee","observation_id":"7d8c3380-d34b-49f4-9707-2f6ca7722d5e","resolution":{"observed_at":"2026-08-07T05:01:02.952757Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2009.09687","last_updated":"2020-09-21T08:54:40Z","snapshot_observed_at":"2026-08-02T07:10:02.529655Z","submitted_at":"2020-09-21T08:54:40Z","title":"Contrastive Clustering","version":1},"cited_work":{"arxiv_id":"2009.09687","doi":null,"metadata_source":"pith","pith_arxiv_id":"2009.09687","snapshot_observed_at":"2026-08-07T05:01:03.181737Z","title":"Contrastive Clustering","venue":"cs.LG","work_id":"d1bdebd7-6a62-4e28-b5e6-b1ba5d892bbb","year":2020},"citing_paper":{"arxiv_id":"2506.09202","last_updated":"2025-06-12T03:14:40Z","snapshot_observed_at":"2026-08-09T14:46:08.724220Z","submitted_at":"2025-06-10T19:44:48Z","title":"Policy-Based Trajectory Clustering in Offline Reinforcement Learning","version":2},"reference_index":2020,"source":"pdf_text","source_observed_at":"2026-08-07T05:01:02.937922Z"},"links":{"cited_paper":"/paper/2009.09687","citing_paper":"/paper/2506.09202"},"observation_digest":"sha256:b229b0e760ca6335c98d2676c174a7acb3b81e8f881c288ca6bf679bd90da894","observation_id":"1b92c03a-6ad1-47e1-9b08-ad2ba2ea496f","resolution":{"observed_at":"2026-08-07T05:01:03.186412Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2002.00444","last_updated":"2021-01-23T17:02:01Z","snapshot_observed_at":"2026-08-10T19:09:22.040361Z","submitted_at":"2020-02-02T18:21:22Z","title":"Deep Reinforcement Learning for Autonomous Driving: A Survey","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2002.00444","snapshot_observed_at":"2026-08-07T05:01:02.932706Z","title":"Martin Klissarov, Pierre-Luc Bacon, Joelle Pineau, and Doina Precup","venue":null,"work_id":null,"year":2002},"citing_paper":{"arxiv_id":"2506.09202","last_updated":"2025-06-12T03:14:40Z","snapshot_observed_at":"2026-08-09T14:46:08.724220Z","submitted_at":"2025-06-10T19:44:48Z","title":"Policy-Based Trajectory Clustering in Offline Reinforcement Learning","version":2},"reference_index":2021,"source":"pdf_text","source_observed_at":"2026-08-07T05:01:02.932706Z"},"links":{"cited_paper":"/paper/2002.00444","citing_paper":"/paper/2506.09202"},"observation_digest":"sha256:0f0605211e5c321a3c3d01819a049d16ea42bd8e4d7a31c66f9b7b050fa6a2e8","observation_id":"2e6a45a0-9bee-4608-80df-30b917f176a3","resolution":{"observed_at":"2026-08-07T05:01:02.932706Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2402.09550","last_updated":"2024-02-14T20:01:41Z","snapshot_observed_at":"2026-07-06T17:30:16.881701Z","submitted_at":"2024-02-14T20:01:41Z","title":"Dataset Clustering for Improved Offline Policy Learning","version":1},"cited_work":{"arxiv_id":"2402.09550","doi":null,"metadata_source":"pith","pith_arxiv_id":"2402.09550","snapshot_observed_at":"2026-08-07T05:01:03.053933Z","title":"Dataset Clustering for Improved Offline Policy Learning","venue":"cs.LG","work_id":"5c0ddb92-3ab9-420f-9ba1-4665f151d72a","year":2024},"citing_paper":{"arxiv_id":"2506.09202","last_updated":"2025-06-12T03:14:40Z","snapshot_observed_at":"2026-08-09T14:46:08.724220Z","submitted_at":"2025-06-10T19:44:48Z","title":"Policy-Based Trajectory Clustering in Offline Reinforcement Learning","version":2},"reference_index":2024,"source":"pdf_text","source_observed_at":"2026-08-07T05:01:02.947723Z"},"links":{"cited_paper":"/paper/2402.09550","citing_paper":"/paper/2506.09202"},"observation_digest":"sha256:8b86def099000e195c4b212c8d8c9534343f0afa0a020cfb4df64cb70cc062e4","observation_id":"80ea89f9-9ee0-454e-bc69-aece7f06d8c5","resolution":{"observed_at":"2026-08-07T05:01:03.060042Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"2023.32801","doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:01:03.159882Z","title":"URL http://dx.doi.org/10.1109/TNNLS.2023","venue":null,"work_id":"c4e5c886-fb44-4869-82ab-7f120c92daaf","year":2023},"citing_paper":{"arxiv_id":"2506.09202","last_updated":"2025-06-12T03:14:40Z","snapshot_observed_at":"2026-08-09T14:46:08.724220Z","submitted_at":"2025-06-10T19:44:48Z","title":"Policy-Based Trajectory Clustering in Offline Reinforcement Learning","version":2},"reference_index":2388,"source":"pdf_text","source_observed_at":"2026-08-07T05:01:02.942412Z"},"links":{"citing_paper":"/paper/2506.09202"},"observation_digest":"sha256:2b15495a4e91bdba1208659eb18b2b3d6459ad077b381bd7cf29ba4deb1e7181","observation_id":"7d86d253-c3c4-42db-ae9c-ef56f3c9b302","resolution":{"observed_at":"2026-08-07T05:01:03.166577Z","resolver_source":"raw_fallback","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}}],"paper":{"arxiv_id":"2506.09202","last_updated":"2025-06-12T03:14:40Z","latest_version":2,"primary_category":"cs.LG","snapshot_observed_at":"2026-08-09T14:46:08.724220Z","submitted_at":"2025-06-10T19:44:48Z","title":"Policy-Based Trajectory Clustering in Offline Reinforcement Learning"},"reference_resolution":{"displayed":13,"state_counts":{"malformed_identifier":0,"metadata_mismatch":3,"parse_uncertain":0,"unresolved":8,"verified_exact":0,"verified_fuzzy":2},"total_outbound_references":13},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"thesis":"As of 12 August 2026, this Paper Citation Record lists 13 of 13 outbound references and 2 inbound Pith citation observations for arXiv:2506.09202."}