{"as_of":"2026-08-10T10:14:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:14a1b0278a87f69479d2b0bf0cbaad82bcc1d24990e1e7e42e4a302d64d9c96c","coverage":[{"denominator":0,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":19,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":19,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-10T06:31:04.303077+00:00","state":"measured"},{"denominator":19,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":19,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-08T19:20:33.558796Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"arxiv_reference","source_observed_at":"2026-07-04T16:49:58.308235Z","state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2412.09858","last_updated":"2024-12-13T04:57:55Z","snapshot_observed_at":"2026-07-06T20:06:21.957662Z","submitted_at":"2024-12-13T04:57:55Z","title":"RLDG: Robotic Generalist Policy Distillation via Reinforcement Learning","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2412.09858","snapshot_observed_at":"2026-08-08T19:20:33.558796Z","title":"RLDG: robotic generalist policy distillation via reinforce- ment learning","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2502.05450","last_updated":"2025-04-14T04:53:32Z","snapshot_observed_at":"2026-08-08T19:14:06.157767Z","submitted_at":"2025-02-08T05:01:17Z","title":"ConRFT: A Reinforced Fine-tuning Method for VLA Models via Consistency Policy","version":2},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-08T19:20:33.558796Z"},"links":{"cited_paper":"/paper/2412.09858","citing_paper":"/paper/2502.05450"},"observation_digest":"sha256:a9416999c4ed47aba80f51a92f64e8ae21cb1be1cef2ec9af26ff0c9f56de097","observation_id":"4b34cab0-a854-47b8-b372-e815dbf85c9e","resolution":{"observed_at":"2026-08-08T19:20:33.558796Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2412.09858","last_updated":"2024-12-13T04:57:55Z","snapshot_observed_at":"2026-07-06T20:06:21.957662Z","submitted_at":"2024-12-13T04:57:55Z","title":"RLDG: Robotic Generalist Policy Distillation via Reinforcement Learning","version":1},"cited_work":{"arxiv_id":"2412.09858","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2412.09858","snapshot_observed_at":"2026-07-04T16:49:58.308235Z","title":"arXiv preprint arXiv:2412.09858 (2024) 9","venue":null,"work_id":"dc18ada4-64cb-4f30-bb77-9e188be519f2","year":2024},"citing_paper":{"arxiv_id":"2505.18719","last_updated":"2025-05-24T14:42:51Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-05-24T14:42:51Z","title":"VLA-RL: Towards Masterful and General Robotic Manipulation with Scalable Reinforcement Learning","version":1},"reference_index":78,"source":"pdf_text","source_observed_at":"2026-05-16T12:55:40.245908Z"},"links":{"cited_paper":"/paper/2412.09858","citing_paper":"/paper/2505.18719"},"observation_digest":"sha256:4aeba709a3017d249027507b81cc8a2f7678999584d0eebc5f6696b113dd9831","observation_id":"3364acc7-9aa7-4326-8492-fcdad8c6e926","resolution":{"observed_at":"2026-05-16T12:55:40.358784Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2412.09858","last_updated":"2024-12-13T04:57:55Z","snapshot_observed_at":"2026-07-06T20:06:21.957662Z","submitted_at":"2024-12-13T04:57:55Z","title":"RLDG: Robotic Generalist Policy Distillation via Reinforcement Learning","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2412.09858","snapshot_observed_at":"2026-08-06T19:26:17.660152Z","title":"Rldg: Robotic generalist policy dis- tillation via reinforcement learning","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.05674","last_updated":"2025-09-12T04:53:53Z","snapshot_observed_at":"2026-08-07T06:19:36.738976Z","submitted_at":"2025-07-08T04:57:23Z","title":"Integrating Diffusion-based Multi-task Learning with Online Reinforcement Learning for Robust Quadruped Robot Control","version":2},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-06T19:26:17.660152Z"},"links":{"cited_paper":"/paper/2412.09858","citing_paper":"/paper/2507.05674"},"observation_digest":"sha256:4b53fb99050f9be80ed605075af1a6d4d0ea629cb117c51b5e5151300b44b366","observation_id":"360cd47c-54bd-481e-a586-d2ea7a05add6","resolution":{"observed_at":"2026-08-06T19:26:17.660152Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2412.09858","last_updated":"2024-12-13T04:57:55Z","snapshot_observed_at":"2026-07-06T20:06:21.957662Z","submitted_at":"2024-12-13T04:57:55Z","title":"RLDG: Robotic Generalist Policy Distillation via Reinforcement Learning","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2412.09858","snapshot_observed_at":"2026-08-05T16:41:54.320097Z","title":"RLDG: Robotic generalist policy distillation via reinforcement learning","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2508.18066","last_updated":"2025-08-25T14:22:40Z","snapshot_observed_at":"2026-08-09T12:55:02.482123Z","submitted_at":"2025-08-25T14:22:40Z","title":"Arnold: a generalist muscle transformer policy","version":1},"reference_index":48,"source":"pdf_text","source_observed_at":"2026-08-05T16:41:54.320097Z"},"links":{"cited_paper":"/paper/2412.09858","citing_paper":"/paper/2508.18066"},"observation_digest":"sha256:0e70386505b70faba69e68cf209eda261ff34127fe94de302489d61d4922fc61","observation_id":"898b5141-124a-41f3-8456-6dccdf659324","resolution":{"observed_at":"2026-08-05T16:41:54.320097Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2412.09858","last_updated":"2024-12-13T04:57:55Z","snapshot_observed_at":"2026-07-06T20:06:21.957662Z","submitted_at":"2024-12-13T04:57:55Z","title":"RLDG: Robotic Generalist Policy Distillation via Reinforcement Learning","version":1},"cited_work":{"arxiv_id":"2412.09858","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2412.09858","snapshot_observed_at":"2026-07-04T16:49:58.308235Z","title":"arXiv preprint arXiv:2412.09858 (2024) 9","venue":null,"work_id":"dc18ada4-64cb-4f30-bb77-9e188be519f2","year":2024},"citing_paper":{"arxiv_id":"2511.14759","last_updated":"2025-11-19T04:34:49Z","snapshot_observed_at":"2026-07-06T22:36:13.287872Z","submitted_at":"2025-11-18T18:58:55Z","title":"$\\pi^{*}_{0.6}$: a VLA That Learns From Experience","version":2},"reference_index":43,"source":"pdf_text","source_observed_at":"2026-05-12T10:34:59.134604Z"},"links":{"cited_paper":"/paper/2412.09858","citing_paper":"/paper/2511.14759"},"observation_digest":"sha256:201a01e55b32f6a85faa58e83ddea26bba5a01f3803a98cdf4c55d34d96783e0","observation_id":"298d2bfe-c995-4e35-9711-a71c32863790","resolution":{"observed_at":"2026-05-12T10:34:59.374709Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2412.09858","last_updated":"2024-12-13T04:57:55Z","snapshot_observed_at":"2026-07-06T20:06:21.957662Z","submitted_at":"2024-12-13T04:57:55Z","title":"RLDG: Robotic Generalist Policy Distillation via Reinforcement Learning","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2412.09858","snapshot_observed_at":"2026-08-02T23:48:00.200266Z","title":"RLDG: robotic generalist policy distillation via rein- forcement learning.CoRR, abs/2412.09858, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2602.12691","last_updated":"2026-06-20T06:22:27Z","snapshot_observed_at":"2026-08-06T14:37:27.953191Z","submitted_at":"2026-02-13T07:46:37Z","title":"ALOE: Action-Level Off-Policy Evaluation for Vision-Language-Action Model Post-Training","version":3},"reference_index":51,"source":"pdf_text","source_observed_at":"2026-08-02T23:48:00.200266Z"},"links":{"cited_paper":"/paper/2412.09858","citing_paper":"/paper/2602.12691"},"observation_digest":"sha256:ea6a5b67d174bc435eefe923a940189bf17ab14b573623cb83187f6b6a1f0b51","observation_id":"1fe7b4aa-83b4-4e27-a0c9-959c76ea977d","resolution":{"observed_at":"2026-08-02T23:48:00.200266Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2412.09858","last_updated":"2024-12-13T04:57:55Z","snapshot_observed_at":"2026-07-06T20:06:21.957662Z","submitted_at":"2024-12-13T04:57:55Z","title":"RLDG: Robotic Generalist Policy Distillation via Reinforcement Learning","version":1},"cited_work":{"arxiv_id":"2412.09858","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2412.09858","snapshot_observed_at":"2026-07-04T16:49:58.308235Z","title":"arXiv preprint arXiv:2412.09858 (2024) 9","venue":null,"work_id":"dc18ada4-64cb-4f30-bb77-9e188be519f2","year":2024},"citing_paper":{"arxiv_id":"2604.15483","last_updated":"2026-04-24T23:18:28Z","snapshot_observed_at":"2026-08-05T18:18:04.172934Z","submitted_at":"2026-04-16T19:18:07Z","title":"${\\pi}_{0.7}$: a Steerable Generalist Robotic Foundation Model with Emergent Capabilities","version":2},"reference_index":53,"source":"pdf_text","source_observed_at":"2026-05-10T11:42:34.409651Z"},"links":{"cited_paper":"/paper/2412.09858","citing_paper":"/paper/2604.15483"},"observation_digest":"sha256:35920e7a2e4efabd40426224b65ef1879cae9ab8107c53449fa11aa1452c5235","observation_id":"a6bac5bf-d19d-453b-b1a2-575a2262b002","resolution":{"observed_at":"2026-05-10T11:45:21.728091Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2412.09858","last_updated":"2024-12-13T04:57:55Z","snapshot_observed_at":"2026-07-06T20:06:21.957662Z","submitted_at":"2024-12-13T04:57:55Z","title":"RLDG: Robotic Generalist Policy Distillation via Reinforcement Learning","version":1},"cited_work":{"arxiv_id":"2412.09858","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2412.09858","snapshot_observed_at":"2026-07-04T16:49:58.308235Z","title":"arXiv preprint arXiv:2412.09858 (2024) 9","venue":null,"work_id":"dc18ada4-64cb-4f30-bb77-9e188be519f2","year":2024},"citing_paper":{"arxiv_id":"2605.00416","last_updated":"2026-06-03T08:01:40Z","snapshot_observed_at":"2026-07-06T23:13:52.304925Z","submitted_at":"2026-05-01T05:20:26Z","title":"Learning While Deploying: Fleet-Scale Reinforcement Learning for Generalist Robot Policies","version":1},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-05-09T19:31:38.069592Z"},"links":{"cited_paper":"/paper/2412.09858","citing_paper":"/paper/2605.00416"},"observation_digest":"sha256:db24c674f111821c73b0abc782b48e784e8f3ab17384d6a552dfd35e593954cc","observation_id":"1a33a8ec-78ce-4ec8-acf0-89a077ad6181","resolution":{"observed_at":"2026-05-11T15:36:10.916898Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2412.09858","last_updated":"2024-12-13T04:57:55Z","snapshot_observed_at":"2026-07-06T20:06:21.957662Z","submitted_at":"2024-12-13T04:57:55Z","title":"RLDG: Robotic Generalist Policy Distillation via Reinforcement Learning","version":1},"cited_work":{"arxiv_id":"2412.09858","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2412.09858","snapshot_observed_at":"2026-07-04T16:49:58.308235Z","title":"arXiv preprint arXiv:2412.09858 (2024) 9","venue":null,"work_id":"dc18ada4-64cb-4f30-bb77-9e188be519f2","year":2024},"citing_paper":{"arxiv_id":"2605.00416","last_updated":"2026-06-03T08:01:40Z","snapshot_observed_at":"2026-07-06T23:13:52.304925Z","submitted_at":"2026-05-01T05:20:26Z","title":"Learning While Deploying: Fleet-Scale Reinforcement Learning for Generalist Robot Policies","version":2},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-07-01T08:05:47.128354Z"},"links":{"cited_paper":"/paper/2412.09858","citing_paper":"/paper/2605.00416"},"observation_digest":"sha256:1ae4eaa66a0456cd2ee26801d2d922fdfa85ca8f53953a7e3da481c862ab02da","observation_id":"8f56a2a4-f713-460f-b1f0-517b52dff45c","resolution":{"observed_at":"2026-07-01T08:15:32.390805Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2412.09858","last_updated":"2024-12-13T04:57:55Z","snapshot_observed_at":"2026-07-06T20:06:21.957662Z","submitted_at":"2024-12-13T04:57:55Z","title":"RLDG: Robotic Generalist Policy Distillation via Reinforcement Learning","version":1},"cited_work":{"arxiv_id":"2412.09858","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2412.09858","snapshot_observed_at":"2026-07-04T16:49:58.308235Z","title":"arXiv preprint arXiv:2412.09858 (2024) 9","venue":null,"work_id":"dc18ada4-64cb-4f30-bb77-9e188be519f2","year":2024},"citing_paper":{"arxiv_id":"2605.25210","last_updated":"2026-05-24T18:19:40Z","snapshot_observed_at":"2026-07-31T17:51:56.004972Z","submitted_at":"2026-05-24T18:19:40Z","title":"Multi-Objective Learning for Diffusion Models: A Statistical Theory under Semi-Supervised Learning","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-06-30T12:09:27.409746Z"},"links":{"cited_paper":"/paper/2412.09858","citing_paper":"/paper/2605.25210"},"observation_digest":"sha256:4959a8523635332af874513940d11394c365c865201a819a1707098c2d216d27","observation_id":"6008e264-f2bc-4cc8-b535-58f40c74c76b","resolution":{"observed_at":"2026-06-30T12:34:39.422800Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2412.09858","last_updated":"2024-12-13T04:57:55Z","snapshot_observed_at":"2026-07-06T20:06:21.957662Z","submitted_at":"2024-12-13T04:57:55Z","title":"RLDG: Robotic Generalist Policy Distillation via Reinforcement Learning","version":1},"cited_work":{"arxiv_id":"2412.09858","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2412.09858","snapshot_observed_at":"2026-07-04T16:49:58.308235Z","title":"arXiv preprint arXiv:2412.09858 (2024) 9","venue":null,"work_id":"dc18ada4-64cb-4f30-bb77-9e188be519f2","year":2024},"citing_paper":{"arxiv_id":"2606.06461","last_updated":"2026-06-04T17:51:12Z","snapshot_observed_at":"2026-07-06T23:46:15.936608Z","submitted_at":"2026-06-04T17:51:12Z","title":"Flow-based Policy Adaptation without Policy Updates","version":1},"reference_index":47,"source":"pdf_text","source_observed_at":"2026-06-28T01:18:08.001674Z"},"links":{"cited_paper":"/paper/2412.09858","citing_paper":"/paper/2606.06461"},"observation_digest":"sha256:399e26bd99f811a4012046dd9be18b1b1d15439d0ac6da8c97dbd13bfa0498af","observation_id":"17a9adad-e6d9-44dc-9c31-3d559f5d3484","resolution":{"observed_at":"2026-07-02T13:26:59.171127Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2412.09858","last_updated":"2024-12-13T04:57:55Z","snapshot_observed_at":"2026-07-06T20:06:21.957662Z","submitted_at":"2024-12-13T04:57:55Z","title":"RLDG: Robotic Generalist Policy Distillation via Reinforcement Learning","version":1},"cited_work":{"arxiv_id":"2412.09858","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2412.09858","snapshot_observed_at":"2026-07-04T16:49:58.308235Z","title":"arXiv preprint arXiv:2412.09858 (2024) 9","venue":null,"work_id":"dc18ada4-64cb-4f30-bb77-9e188be519f2","year":2024},"citing_paper":{"arxiv_id":"2606.09615","last_updated":"2026-06-08T15:21:45Z","snapshot_observed_at":"2026-08-03T16:03:00.502890Z","submitted_at":"2026-06-08T15:21:45Z","title":"DexPIE: Stable Dexterous Policy Improvement from Real-World Experience","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-06-27T16:47:22.504175Z"},"links":{"cited_paper":"/paper/2412.09858","citing_paper":"/paper/2606.09615"},"observation_digest":"sha256:9331d161659b3935d9e0d4b7a3ea9441ab679c1fddd052aacd6f1f081255f790","observation_id":"8270259e-b914-4de0-851f-481fa9787007","resolution":{"observed_at":"2026-07-03T01:07:30.753147Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2412.09858","last_updated":"2024-12-13T04:57:55Z","snapshot_observed_at":"2026-07-06T20:06:21.957662Z","submitted_at":"2024-12-13T04:57:55Z","title":"RLDG: Robotic Generalist Policy Distillation via Reinforcement Learning","version":1},"cited_work":{"arxiv_id":"2412.09858","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2412.09858","snapshot_observed_at":"2026-07-04T16:49:58.308235Z","title":"arXiv preprint arXiv:2412.09858 (2024) 9","venue":null,"work_id":"dc18ada4-64cb-4f30-bb77-9e188be519f2","year":2024},"citing_paper":{"arxiv_id":"2606.10927","last_updated":"2026-06-09T14:35:53Z","snapshot_observed_at":"2026-08-01T15:29:53.973770Z","submitted_at":"2026-06-09T14:35:53Z","title":"AllDayNav: Lifelong Navigation via Real-World Reinforcement Learning","version":1},"reference_index":62,"source":"pdf_text","source_observed_at":"2026-06-27T13:25:59.194721Z"},"links":{"cited_paper":"/paper/2412.09858","citing_paper":"/paper/2606.10927"},"observation_digest":"sha256:1524aede37c26b7ce150179847507e90141955cfff91923dfb41a180305a7efa","observation_id":"cfbea7c4-f093-4a13-9c56-293551becfd1","resolution":{"observed_at":"2026-07-03T05:07:38.967081Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2412.09858","last_updated":"2024-12-13T04:57:55Z","snapshot_observed_at":"2026-07-06T20:06:21.957662Z","submitted_at":"2024-12-13T04:57:55Z","title":"RLDG: Robotic Generalist Policy Distillation via Reinforcement Learning","version":1},"cited_work":{"arxiv_id":"2412.09858","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2412.09858","snapshot_observed_at":"2026-07-04T16:49:58.308235Z","title":"arXiv preprint arXiv:2412.09858 (2024) 9","venue":null,"work_id":"dc18ada4-64cb-4f30-bb77-9e188be519f2","year":2024},"citing_paper":{"arxiv_id":"2606.13675","last_updated":"2026-06-11T17:59:45Z","snapshot_observed_at":"2026-07-30T00:58:38.369141Z","submitted_at":"2026-06-11T17:59:45Z","title":"Improving Robotic Generalist Policies via Flow Reversal Steering","version":1},"reference_index":48,"source":"pdf_text","source_observed_at":"2026-06-27T06:20:19.209180Z"},"links":{"cited_paper":"/paper/2412.09858","citing_paper":"/paper/2606.13675"},"observation_digest":"sha256:3e603df2ced9926852797640e76f03500735f1e973195e34d37930c490717da2","observation_id":"dc49a3a3-079f-48c7-82cc-22ea3731d402","resolution":{"observed_at":"2026-07-03T15:48:35.751705Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2412.09858","last_updated":"2024-12-13T04:57:55Z","snapshot_observed_at":"2026-07-06T20:06:21.957662Z","submitted_at":"2024-12-13T04:57:55Z","title":"RLDG: Robotic Generalist Policy Distillation via Reinforcement Learning","version":1},"cited_work":{"arxiv_id":"2412.09858","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2412.09858","snapshot_observed_at":"2026-07-04T16:49:58.308235Z","title":"arXiv preprint arXiv:2412.09858 (2024) 9","venue":null,"work_id":"dc18ada4-64cb-4f30-bb77-9e188be519f2","year":2024},"citing_paper":{"arxiv_id":"2606.16776","last_updated":"2026-06-28T12:48:48Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2026-06-15T14:21:35Z","title":"JoyAI-Sim: A Simulation-Enabled Interconversion Toolchain for the Embodied Data Pyramid","version":2},"reference_index":48,"source":"pdf_text","source_observed_at":"2026-06-30T10:31:54.292897Z"},"links":{"cited_paper":"/paper/2412.09858","citing_paper":"/paper/2606.16776"},"observation_digest":"sha256:beaa1d8b95b762d6c664aef2c308c11a3fcefd47f6b4385d1a9429637d7bff5a","observation_id":"62d40101-1ed8-4d44-9e87-b271bf9dba30","resolution":{"observed_at":"2026-06-30T10:34:36.299082Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2412.09858","last_updated":"2024-12-13T04:57:55Z","snapshot_observed_at":"2026-07-06T20:06:21.957662Z","submitted_at":"2024-12-13T04:57:55Z","title":"RLDG: Robotic Generalist Policy Distillation via Reinforcement Learning","version":1},"cited_work":{"arxiv_id":"2412.09858","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2412.09858","snapshot_observed_at":"2026-07-04T16:49:58.308235Z","title":"arXiv preprint arXiv:2412.09858 (2024) 9","venue":null,"work_id":"dc18ada4-64cb-4f30-bb77-9e188be519f2","year":2024},"citing_paper":{"arxiv_id":"2606.22471","last_updated":"2026-06-29T14:49:32Z","snapshot_observed_at":"2026-08-07T17:41:39.498544Z","submitted_at":"2026-06-21T12:31:59Z","title":"Scalable Multi-Task Data Generation via Reinforcement Learning for Language-Conditioned Bimanual Dexterous Manipulation","version":1},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-06-26T10:18:01.230648Z"},"links":{"cited_paper":"/paper/2412.09858","citing_paper":"/paper/2606.22471"},"observation_digest":"sha256:ea4a120d627e6b9ab878beea2916f7c4bf17d32c99d58f20c342406163275b8d","observation_id":"e2a28978-94d0-46ca-aa7e-c48aa2622140","resolution":{"observed_at":"2026-07-04T09:19:42.939427Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2412.09858","last_updated":"2024-12-13T04:57:55Z","snapshot_observed_at":"2026-07-06T20:06:21.957662Z","submitted_at":"2024-12-13T04:57:55Z","title":"RLDG: Robotic Generalist Policy Distillation via Reinforcement Learning","version":1},"cited_work":{"arxiv_id":"2412.09858","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2412.09858","snapshot_observed_at":"2026-07-04T16:49:58.308235Z","title":"arXiv preprint arXiv:2412.09858 (2024) 9","venue":null,"work_id":"dc18ada4-64cb-4f30-bb77-9e188be519f2","year":2024},"citing_paper":{"arxiv_id":"2606.22471","last_updated":"2026-06-29T14:49:32Z","snapshot_observed_at":"2026-08-07T17:41:39.498544Z","submitted_at":"2026-06-21T12:31:59Z","title":"Scalable Multi-Task Data Generation via Reinforcement Learning for Language-Conditioned Bimanual Dexterous Manipulation","version":2},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-06-30T10:46:26.385071Z"},"links":{"cited_paper":"/paper/2412.09858","citing_paper":"/paper/2606.22471"},"observation_digest":"sha256:8f1bc81617ec9aae6d36b0bf9a1754bafa2099e3d72d1e0065f773a25b9164e3","observation_id":"0fb83220-c451-4f5b-8c9c-c6527a00d5d1","resolution":{"observed_at":"2026-06-30T10:54:36.971120Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2412.09858","last_updated":"2024-12-13T04:57:55Z","snapshot_observed_at":"2026-07-06T20:06:21.957662Z","submitted_at":"2024-12-13T04:57:55Z","title":"RLDG: Robotic Generalist Policy Distillation via Reinforcement Learning","version":1},"cited_work":{"arxiv_id":"2412.09858","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2412.09858","snapshot_observed_at":"2026-07-04T16:49:58.308235Z","title":"arXiv preprint arXiv:2412.09858 (2024) 9","venue":null,"work_id":"dc18ada4-64cb-4f30-bb77-9e188be519f2","year":2024},"citing_paper":{"arxiv_id":"2606.24884","last_updated":"2026-06-23T17:59:01Z","snapshot_observed_at":"2026-08-08T03:34:49.957851Z","submitted_at":"2026-06-23T17:59:01Z","title":"InSight: Self-Guided Skill Acquisition via Steerable VLAs","version":1},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-06-26T00:10:51.721485Z"},"links":{"cited_paper":"/paper/2412.09858","citing_paper":"/paper/2606.24884"},"observation_digest":"sha256:fc59d83f235195ffc3f30f4b7363cefef6d5e63a736a9901a2c579fad77a627a","observation_id":"e64a8b7e-6135-4813-bd8b-490bde4e5899","resolution":{"observed_at":"2026-07-04T16:49:58.309660Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2412.09858","last_updated":"2024-12-13T04:57:55Z","snapshot_observed_at":"2026-07-06T20:06:21.957662Z","submitted_at":"2024-12-13T04:57:55Z","title":"RLDG: Robotic Generalist Policy Distillation via Reinforcement Learning","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2412.09858","snapshot_observed_at":"2026-08-01T14:39:52.278110Z","title":"arXiv preprint arXiv:2412.09858 , year=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.18709","last_updated":"2026-07-22T05:33:17Z","snapshot_observed_at":"2026-08-08T18:57:26.098275Z","submitted_at":"2026-07-21T05:05:01Z","title":"RoboInter1.5: A Holistic Intermediate Representation Suite for Embodied World Modeling and Robotic Manipulation","version":2},"reference_index":189,"source":"arxiv_source","source_observed_at":"2026-08-01T14:39:52.278110Z"},"links":{"cited_paper":"/paper/2412.09858","citing_paper":"/paper/2607.18709"},"observation_digest":"sha256:d6cd599cce95819e2ed549d906486eb8386ae44b15e960b4b9a971b737687b8e","observation_id":"6f15f21a-c235-49f2-ad1e-e3fc6bf16095","resolution":{"observed_at":"2026-08-01T14:39:52.278110Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"links":{"evidence":"/evidence","html":"/paper/2412.09858/citation-record","integrity":"/paper/2412.09858/integrity","json":"/paper/2412.09858/citation-record.json","paper":"/paper/2412.09858"},"outbound":[],"paper":{"arxiv_id":"2412.09858","last_updated":"2024-12-13T04:57:55Z","latest_version":1,"primary_category":"cs.RO","snapshot_observed_at":"2026-07-06T20:06:21.957662Z","submitted_at":"2024-12-13T04:57:55Z","title":"RLDG: Robotic Generalist Policy Distillation via Reinforcement Learning"},"reference_resolution":{"displayed":0,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":0,"verified_exact":0,"verified_fuzzy":0},"total_outbound_references":0},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"thesis":"As of 10 August 2026, this Paper Citation Record lists 0 of 0 outbound references and 19 inbound Pith citation observations for arXiv:2412.09858."}