{"as_of":"2026-08-18T12:25:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:07a4f51041887d45a27caae602b651787b91dcccd0abce723cbd4c6d64e350dd","coverage":[{"denominator":32,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":32,"source":"paper_references, paper_reference_links","source_observed_at":"2026-07-13T01:56:20.542865Z","state":"measured"},{"denominator":32,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":32,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-18T06:34:40.430872+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2607.09590/citation-record","integrity":"/paper/2607.09590/integrity","json":"/paper/2607.09590/citation-record.json","paper":"/paper/2607.09590"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-13T01:56:20.542865Z","title":"Visual servo control. I. Basic ap- proaches,","venue":null,"work_id":null,"year":2006},"citing_paper":{"arxiv_id":"2607.09590","last_updated":"2026-07-10T16:42:17Z","snapshot_observed_at":"2026-08-13T20:45:04.704835Z","submitted_at":"2026-07-10T16:42:17Z","title":"PAC-ACT: Post-training Actor-Critic for Action Chunking Transformers","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-07-13T01:56:20.542865Z"},"links":{"citing_paper":"/paper/2607.09590"},"observation_digest":"sha256:725a222839f7e33c53756a07eaaf98883ec6de0cd014aa60c02329d551b551bb","observation_id":"4f922d12-d744-47cc-bde8-0b4bd6501574","resolution":{"observed_at":"2026-07-13T01:56:20.542865Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":"10.1016/j.robot.2006.05.002","metadata_source":"openalex","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Measurement errors in visual servoing,","venue":"Robotics and Autonomous Systems","work_id":"76f879d0-fd40-4eea-b39d-8d5506ada3c2","year":2006},"citing_paper":{"arxiv_id":"2607.09590","last_updated":"2026-07-10T16:42:17Z","snapshot_observed_at":"2026-08-13T20:45:04.704835Z","submitted_at":"2026-07-10T16:42:17Z","title":"PAC-ACT: Post-training Actor-Critic for Action Chunking Transformers","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-07-13T01:56:20.542865Z"},"links":{"citing_paper":"/paper/2607.09590"},"observation_digest":"sha256:a6d15f58b28603bae946c403d76320f7b6d97b04b19cfb465bc8642a63990d68","observation_id":"f258a2d1-63bf-4642-a833-d4193ebc5e86","resolution":{"observed_at":"2026-07-13T01:59:15.400499Z","resolver_source":"doi","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-07-20T16:22:02.482094+00:00","source":"crossref_status_cache"},{"observed_at":"2026-07-20T16:22:02.482094+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-13T01:56:20.542865Z","title":"Learning fine-grained bimanual manipulation with low-cost hardware,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2607.09590","last_updated":"2026-07-10T16:42:17Z","snapshot_observed_at":"2026-08-13T20:45:04.704835Z","submitted_at":"2026-07-10T16:42:17Z","title":"PAC-ACT: Post-training Actor-Critic for Action Chunking Transformers","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-07-13T01:56:20.542865Z"},"links":{"citing_paper":"/paper/2607.09590"},"observation_digest":"sha256:e2668a8d6fba7691f1d382651ff6f8cd1744f1d33fa35240c946f30a9436b0a0","observation_id":"6f926935-2c61-48d5-ba4b-20d11493d94f","resolution":{"observed_at":"2026-07-13T01:56:20.542865Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-13T01:56:20.542865Z","title":"A reduction of imitation learning and structured prediction to no-regret online learning,","venue":null,"work_id":null,"year":2011},"citing_paper":{"arxiv_id":"2607.09590","last_updated":"2026-07-10T16:42:17Z","snapshot_observed_at":"2026-08-13T20:45:04.704835Z","submitted_at":"2026-07-10T16:42:17Z","title":"PAC-ACT: Post-training Actor-Critic for Action Chunking Transformers","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-07-13T01:56:20.542865Z"},"links":{"citing_paper":"/paper/2607.09590"},"observation_digest":"sha256:992bc79ab3f0926364680632f0b2d9b501d694fa7e06925b0be3810926ed63c3","observation_id":"56f38be9-251d-45c8-a69c-0f67c737e545","resolution":{"observed_at":"2026-07-13T01:56:20.542865Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-13T01:56:20.542865Z","title":"What matters in learning from offline human demonstrations for robot manipulation,","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2607.09590","last_updated":"2026-07-10T16:42:17Z","snapshot_observed_at":"2026-08-13T20:45:04.704835Z","submitted_at":"2026-07-10T16:42:17Z","title":"PAC-ACT: Post-training Actor-Critic for Action Chunking Transformers","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-07-13T01:56:20.542865Z"},"links":{"citing_paper":"/paper/2607.09590"},"observation_digest":"sha256:fd1ba7fd7c9480112bcdedba1a14eae18eb55ba60cc2ea7263e8ba09ab70c00f","observation_id":"b828162b-e267-4ae5-a29a-20d5d7065145","resolution":{"observed_at":"2026-07-13T01:56:20.542865Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-13T01:56:20.542865Z","title":"A survey of robot manipulation in contact,","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2607.09590","last_updated":"2026-07-10T16:42:17Z","snapshot_observed_at":"2026-08-13T20:45:04.704835Z","submitted_at":"2026-07-10T16:42:17Z","title":"PAC-ACT: Post-training Actor-Critic for Action Chunking Transformers","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-07-13T01:56:20.542865Z"},"links":{"citing_paper":"/paper/2607.09590"},"observation_digest":"sha256:c251d92fe4e6b2beb61002673ed17bfe558d135e4545a148dc7d1d1703e56708","observation_id":"1635ef22-6a4f-4458-9b79-e0ff826c8a3d","resolution":{"observed_at":"2026-07-13T01:56:20.542865Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-13T01:56:20.542865Z","title":"Impedance control: An approach to manipulation: Part I— Theory,","venue":null,"work_id":null,"year":1985},"citing_paper":{"arxiv_id":"2607.09590","last_updated":"2026-07-10T16:42:17Z","snapshot_observed_at":"2026-08-13T20:45:04.704835Z","submitted_at":"2026-07-10T16:42:17Z","title":"PAC-ACT: Post-training Actor-Critic for Action Chunking Transformers","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-07-13T01:56:20.542865Z"},"links":{"citing_paper":"/paper/2607.09590"},"observation_digest":"sha256:072c64f8df66ab35702904229322f8096b77504ed0ad75cc7da66d0d0b78d0e1","observation_id":"cec1b4b3-6aa2-4df4-9be3-bc7ea93a8e7a","resolution":{"observed_at":"2026-07-13T01:56:20.542865Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2503.03660","last_updated":"2026-06-05T11:32:38Z","snapshot_observed_at":"2026-08-16T12:52:47.354222Z","submitted_at":"2025-03-05T16:47:36Z","title":"Chunking the Critic: A Transformer-based Soft Actor-Critic with N-Step Returns","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2503.03660","snapshot_observed_at":"2026-07-13T01:56:20.542865Z","title":"Chunking the critic: A transformer-based soft actor-critic with n-step returns,","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.09590","last_updated":"2026-07-10T16:42:17Z","snapshot_observed_at":"2026-08-13T20:45:04.704835Z","submitted_at":"2026-07-10T16:42:17Z","title":"PAC-ACT: Post-training Actor-Critic for Action Chunking Transformers","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-07-13T01:56:20.542865Z"},"links":{"cited_paper":"/paper/2503.03660","citing_paper":"/paper/2607.09590"},"observation_digest":"sha256:c5a621875dcfc5b1dc9aec956ed17cbd2bef55d440a40379d6cd92ffd8115ee5","observation_id":"3bbceb78-7385-45e6-9a6c-d1fb5a7e865a","resolution":{"observed_at":"2026-07-13T01:56:20.542865Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-13T01:56:20.542865Z","title":"Reinforcement learning with action chunking,","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.09590","last_updated":"2026-07-10T16:42:17Z","snapshot_observed_at":"2026-08-13T20:45:04.704835Z","submitted_at":"2026-07-10T16:42:17Z","title":"PAC-ACT: Post-training Actor-Critic for Action Chunking Transformers","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-07-13T01:56:20.542865Z"},"links":{"citing_paper":"/paper/2607.09590"},"observation_digest":"sha256:6d92d97a3620253d6989309031602bff0725bc222644c3af1e2784ce5f601e5b","observation_id":"ad8a6034-15eb-49ba-8290-3abfcd38cd23","resolution":{"observed_at":"2026-07-13T01:56:20.542865Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-13T01:56:20.542865Z","title":"LeRobot: An open-source library for end-to-end robot learning,","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2607.09590","last_updated":"2026-07-10T16:42:17Z","snapshot_observed_at":"2026-08-13T20:45:04.704835Z","submitted_at":"2026-07-10T16:42:17Z","title":"PAC-ACT: Post-training Actor-Critic for Action Chunking Transformers","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-07-13T01:56:20.542865Z"},"links":{"citing_paper":"/paper/2607.09590"},"observation_digest":"sha256:5126c4ed4e0321270e9e33103cf9713a1ada917d12af975abacb4ec67a5a46f8","observation_id":"ace6b334-dc3c-41d9-8842-1acd0024546f","resolution":{"observed_at":"2026-07-13T01:56:20.542865Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-13T01:56:20.542865Z","title":"Learning structured output representation using deep conditional generative models,","venue":null,"work_id":null,"year":2015},"citing_paper":{"arxiv_id":"2607.09590","last_updated":"2026-07-10T16:42:17Z","snapshot_observed_at":"2026-08-13T20:45:04.704835Z","submitted_at":"2026-07-10T16:42:17Z","title":"PAC-ACT: Post-training Actor-Critic for Action Chunking Transformers","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-07-13T01:56:20.542865Z"},"links":{"citing_paper":"/paper/2607.09590"},"observation_digest":"sha256:512e2e8eb3c076dfd9316f7c6132cb4d6901f88398d217c2ebecd5d09b42f940","observation_id":"cf6cd62c-eb05-45d9-9d90-0eb8406552a9","resolution":{"observed_at":"2026-07-13T01:56:20.542865Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-13T01:56:20.542865Z","title":"Diffusion policy: Visuomotor policy learning via action diffusion,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2607.09590","last_updated":"2026-07-10T16:42:17Z","snapshot_observed_at":"2026-08-13T20:45:04.704835Z","submitted_at":"2026-07-10T16:42:17Z","title":"PAC-ACT: Post-training Actor-Critic for Action Chunking Transformers","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-07-13T01:56:20.542865Z"},"links":{"citing_paper":"/paper/2607.09590"},"observation_digest":"sha256:4278b75c1cb194c091d6427de91d835feb098a265003e74349d16730c2190c2c","observation_id":"83e26bd3-1d04-4c2c-aab3-17b398e37ec7","resolution":{"observed_at":"2026-07-13T01:56:20.542865Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-13T01:56:20.542865Z","title":"Behavior transformers: Cloningkmodes with one stone,","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2607.09590","last_updated":"2026-07-10T16:42:17Z","snapshot_observed_at":"2026-08-13T20:45:04.704835Z","submitted_at":"2026-07-10T16:42:17Z","title":"PAC-ACT: Post-training Actor-Critic for Action Chunking Transformers","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-07-13T01:56:20.542865Z"},"links":{"citing_paper":"/paper/2607.09590"},"observation_digest":"sha256:d5a7b9c36c6c8787128a5b4c6a4259d59119ee7f017bdae4836af6c16735157a","observation_id":"7a2398f1-78dd-4fd9-a5a6-1a8943ea23ad","resolution":{"observed_at":"2026-07-13T01:56:20.542865Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-13T01:56:20.542865Z","title":"RT-2: Vision-language-action models transfer web knowledge to robotic control,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2607.09590","last_updated":"2026-07-10T16:42:17Z","snapshot_observed_at":"2026-08-13T20:45:04.704835Z","submitted_at":"2026-07-10T16:42:17Z","title":"PAC-ACT: Post-training Actor-Critic for Action Chunking Transformers","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-07-13T01:56:20.542865Z"},"links":{"citing_paper":"/paper/2607.09590"},"observation_digest":"sha256:86cbb5f9987d448f2dad2d3e99a013625cc16747490882e3b2f514c899c0c4a2","observation_id":"3d6b4067-9e11-4a96-b0bb-e1e66aeaa735","resolution":{"observed_at":"2026-07-13T01:56:20.542865Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2504.16054","last_updated":"2025-04-22T17:31:29Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-04-22T17:31:29Z","title":"$\\pi_{0.5}$: a Vision-Language-Action Model with Open-World Generalization","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2504.16054","snapshot_observed_at":"2026-07-13T01:56:20.542865Z","title":"π0.5: a vision-language-action model with open-world generalization,","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.09590","last_updated":"2026-07-10T16:42:17Z","snapshot_observed_at":"2026-08-13T20:45:04.704835Z","submitted_at":"2026-07-10T16:42:17Z","title":"PAC-ACT: Post-training Actor-Critic for Action Chunking Transformers","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-07-13T01:56:20.542865Z"},"links":{"cited_paper":"/paper/2504.16054","citing_paper":"/paper/2607.09590"},"observation_digest":"sha256:d495eae4295ea3fd129fa57b3817d72dbb0b6cb426feca1bbd4bcfa7cc67bad1","observation_id":"30840037-1bda-4f9f-925e-6df950824298","resolution":{"observed_at":"2026-07-13T01:56:20.542865Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-13T01:56:20.542865Z","title":"Implicit behavioral cloning,","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2607.09590","last_updated":"2026-07-10T16:42:17Z","snapshot_observed_at":"2026-08-13T20:45:04.704835Z","submitted_at":"2026-07-10T16:42:17Z","title":"PAC-ACT: Post-training Actor-Critic for Action Chunking Transformers","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-07-13T01:56:20.542865Z"},"links":{"citing_paper":"/paper/2607.09590"},"observation_digest":"sha256:7c434ceffe0aacf1c63f5e6cfdfecedf4b1fe2d819c6c8eece43ae5bada5273c","observation_id":"0d90a820-2411-4440-b666-8fe15505f541","resolution":{"observed_at":"2026-07-13T01:56:20.542865Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-13T01:56:20.542865Z","title":"Coarse-to-fine Q-network with action se- quence for data-efficient reinforcement learning,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.09590","last_updated":"2026-07-10T16:42:17Z","snapshot_observed_at":"2026-08-13T20:45:04.704835Z","submitted_at":"2026-07-10T16:42:17Z","title":"PAC-ACT: Post-training Actor-Critic for Action Chunking Transformers","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-07-13T01:56:20.542865Z"},"links":{"citing_paper":"/paper/2607.09590"},"observation_digest":"sha256:3e97d215ac284b24e95b4914bbe76e25d4557a012a8f9f172aa4086a579d8515","observation_id":"d6206067-75b6-4dc8-86c6-14c8f3b0ba0c","resolution":{"observed_at":"2026-07-13T01:56:20.542865Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-13T01:56:20.542865Z","title":"Soft actor-critic: Off-policy maximum entropy deep reinforcement learning with a stochastic actor,","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2607.09590","last_updated":"2026-07-10T16:42:17Z","snapshot_observed_at":"2026-08-13T20:45:04.704835Z","submitted_at":"2026-07-10T16:42:17Z","title":"PAC-ACT: Post-training Actor-Critic for Action Chunking Transformers","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-07-13T01:56:20.542865Z"},"links":{"citing_paper":"/paper/2607.09590"},"observation_digest":"sha256:c32b396a57c009d64bb6915a73adec1a8ab3918c48ff62dc2b321ce7af4744d4","observation_id":"70a2b9f6-16a9-467c-8c95-9cec381c07c6","resolution":{"observed_at":"2026-07-13T01:56:20.542865Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-13T01:56:20.542865Z","title":"Actor-critic for continuous action chunks: A reinforcement learning framework for long-horizon robotic manipulation with sparse reward,","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2607.09590","last_updated":"2026-07-10T16:42:17Z","snapshot_observed_at":"2026-08-13T20:45:04.704835Z","submitted_at":"2026-07-10T16:42:17Z","title":"PAC-ACT: Post-training Actor-Critic for Action Chunking Transformers","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-07-13T01:56:20.542865Z"},"links":{"citing_paper":"/paper/2607.09590"},"observation_digest":"sha256:77faabb4f04af0b4969777fbdf625879fbfa7d0e9a946fe0f34bd9fdcaab5be9","observation_id":"ff985ec7-44ac-460f-8f04-7723bff78053","resolution":{"observed_at":"2026-07-13T01:56:20.542865Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-13T01:56:20.542865Z","title":"Conservative Q- learning for offline reinforcement learning,","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2607.09590","last_updated":"2026-07-10T16:42:17Z","snapshot_observed_at":"2026-08-13T20:45:04.704835Z","submitted_at":"2026-07-10T16:42:17Z","title":"PAC-ACT: Post-training Actor-Critic for Action Chunking Transformers","version":1},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-07-13T01:56:20.542865Z"},"links":{"citing_paper":"/paper/2607.09590"},"observation_digest":"sha256:98409273cb32aada843d1f4407a801ccc19c96fc6b36aa95249b0d79de015aa0","observation_id":"0d5fd5e8-feae-47a1-aaf1-c27b88f61567","resolution":{"observed_at":"2026-07-13T01:56:20.542865Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-13T01:56:20.542865Z","title":"Offline reinforcement learning with implicit Q-learning,","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2607.09590","last_updated":"2026-07-10T16:42:17Z","snapshot_observed_at":"2026-08-13T20:45:04.704835Z","submitted_at":"2026-07-10T16:42:17Z","title":"PAC-ACT: Post-training Actor-Critic for Action Chunking Transformers","version":1},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-07-13T01:56:20.542865Z"},"links":{"citing_paper":"/paper/2607.09590"},"observation_digest":"sha256:6418bf8acd8ae3720ee1adee8e34c8f664faf14c14f650d8830e9531f22386f1","observation_id":"b31d7d20-e346-4c93-9680-f0058b1dec54","resolution":{"observed_at":"2026-07-13T01:56:20.542865Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-13T01:56:20.542865Z","title":"Safe learning in robotics: From learning-based control to safe reinforcement learning,","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2607.09590","last_updated":"2026-07-10T16:42:17Z","snapshot_observed_at":"2026-08-13T20:45:04.704835Z","submitted_at":"2026-07-10T16:42:17Z","title":"PAC-ACT: Post-training Actor-Critic for Action Chunking Transformers","version":1},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-07-13T01:56:20.542865Z"},"links":{"citing_paper":"/paper/2607.09590"},"observation_digest":"sha256:4bff6e94c122eb86732c2caa44cf5d23335474f5ce0edf42260d0d8c31a9f1ea","observation_id":"93154fcf-97f5-46b3-a1dd-8638be848579","resolution":{"observed_at":"2026-07-13T01:56:20.542865Z","resolver_source":null,"status":"malformed_identifier"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-13T01:56:20.542865Z","title":"Open X-Embodiment: Robotic learning datasets and RT-X models,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.09590","last_updated":"2026-07-10T16:42:17Z","snapshot_observed_at":"2026-08-13T20:45:04.704835Z","submitted_at":"2026-07-10T16:42:17Z","title":"PAC-ACT: Post-training Actor-Critic for Action Chunking Transformers","version":1},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-07-13T01:56:20.542865Z"},"links":{"citing_paper":"/paper/2607.09590"},"observation_digest":"sha256:15b279b1c99f5a61bdf72fba46e5c4552c4c9b38c3c4cc7327a47950289f359f","observation_id":"83e052c6-97bf-4d64-841c-fd69eb2190d6","resolution":{"observed_at":"2026-07-13T01:56:20.542865Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2409.00588","last_updated":"2024-12-09T21:30:07Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-09-01T02:47:50Z","title":"Diffusion Policy Policy Optimization","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2409.00588","snapshot_observed_at":"2026-07-13T01:56:20.542865Z","title":"Diffusion policy policy optimization,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.09590","last_updated":"2026-07-10T16:42:17Z","snapshot_observed_at":"2026-08-13T20:45:04.704835Z","submitted_at":"2026-07-10T16:42:17Z","title":"PAC-ACT: Post-training Actor-Critic for Action Chunking Transformers","version":1},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-07-13T01:56:20.542865Z"},"links":{"cited_paper":"/paper/2409.00588","citing_paper":"/paper/2607.09590"},"observation_digest":"sha256:3978f519e0241cb1efcedf9311ed3bbfc864290631a5e8fb86b8bf7b1375917c","observation_id":"0a61ad18-c644-4b46-b3eb-f0a62b6fc8de","resolution":{"observed_at":"2026-07-13T01:56:20.542865Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-13T01:56:20.542865Z","title":"Deep residual learning for image recognition,","venue":null,"work_id":null,"year":2016},"citing_paper":{"arxiv_id":"2607.09590","last_updated":"2026-07-10T16:42:17Z","snapshot_observed_at":"2026-08-13T20:45:04.704835Z","submitted_at":"2026-07-10T16:42:17Z","title":"PAC-ACT: Post-training Actor-Critic for Action Chunking Transformers","version":1},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-07-13T01:56:20.542865Z"},"links":{"citing_paper":"/paper/2607.09590"},"observation_digest":"sha256:88fefc9d343ca23034bbf9da31a05d3a22cc6ef43e24b01dd49d676d0a0a1c9a","observation_id":"3e4a49ac-292f-467a-b7c5-3aba8838eae3","resolution":{"observed_at":"2026-07-13T01:56:20.542865Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-13T01:56:20.542865Z","title":"Attention is all you need,","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2607.09590","last_updated":"2026-07-10T16:42:17Z","snapshot_observed_at":"2026-08-13T20:45:04.704835Z","submitted_at":"2026-07-10T16:42:17Z","title":"PAC-ACT: Post-training Actor-Critic for Action Chunking Transformers","version":1},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-07-13T01:56:20.542865Z"},"links":{"citing_paper":"/paper/2607.09590"},"observation_digest":"sha256:f096d3171aa200720a3703377592f8feba118acd8f9b314bc715408b9b7382a5","observation_id":"dd0e740b-2363-4473-bbfd-7f03f74e9e61","resolution":{"observed_at":"2026-07-13T01:56:20.542865Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-13T01:56:20.542865Z","title":"R3M: A universal visual representation for robot manipulation,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2607.09590","last_updated":"2026-07-10T16:42:17Z","snapshot_observed_at":"2026-08-13T20:45:04.704835Z","submitted_at":"2026-07-10T16:42:17Z","title":"PAC-ACT: Post-training Actor-Critic for Action Chunking Transformers","version":1},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-07-13T01:56:20.542865Z"},"links":{"citing_paper":"/paper/2607.09590"},"observation_digest":"sha256:02ed12da50c76201c16e53b6ddf02db13e238f8b25259c4851bbc503020aa520","observation_id":"1447139b-7dc0-4bc2-aefd-b00298e1ddf1","resolution":{"observed_at":"2026-07-13T01:56:20.542865Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1707.06347","last_updated":"2017-08-28T09:20:06Z","snapshot_observed_at":"2026-08-15T20:26:32.102285Z","submitted_at":"2017-07-20T02:32:33Z","title":"Proximal Policy Optimization Algorithms","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1707.06347","snapshot_observed_at":"2026-07-13T01:56:20.542865Z","title":"Prox- imal policy optimization algorithms,","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2607.09590","last_updated":"2026-07-10T16:42:17Z","snapshot_observed_at":"2026-08-13T20:45:04.704835Z","submitted_at":"2026-07-10T16:42:17Z","title":"PAC-ACT: Post-training Actor-Critic for Action Chunking Transformers","version":1},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-07-13T01:56:20.542865Z"},"links":{"cited_paper":"/paper/1707.06347","citing_paper":"/paper/2607.09590"},"observation_digest":"sha256:113b9fadcc122d608f493baa45a18d72508e1242f14d4c1a06bdcfdd756a89ec","observation_id":"db3f1c5c-ac5b-4c7d-84e8-1b12030912fc","resolution":{"observed_at":"2026-07-13T01:56:20.542865Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-13T01:56:20.542865Z","title":"Trust re- gion policy optimization,","venue":null,"work_id":null,"year":2015},"citing_paper":{"arxiv_id":"2607.09590","last_updated":"2026-07-10T16:42:17Z","snapshot_observed_at":"2026-08-13T20:45:04.704835Z","submitted_at":"2026-07-10T16:42:17Z","title":"PAC-ACT: Post-training Actor-Critic for Action Chunking Transformers","version":1},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-07-13T01:56:20.542865Z"},"links":{"citing_paper":"/paper/2607.09590"},"observation_digest":"sha256:b4e9165bebbb11e700c3afa82bda0c20e2fcb003cf1d1a3629c2a3b0a30e04b0","observation_id":"947c5a34-629f-4157-984e-c7e5b219886e","resolution":{"observed_at":"2026-07-13T01:56:20.542865Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-13T01:56:20.542865Z","title":"MuJoCo: A physics engine for model-based control,","venue":null,"work_id":null,"year":2012},"citing_paper":{"arxiv_id":"2607.09590","last_updated":"2026-07-10T16:42:17Z","snapshot_observed_at":"2026-08-13T20:45:04.704835Z","submitted_at":"2026-07-10T16:42:17Z","title":"PAC-ACT: Post-training Actor-Critic for Action Chunking Transformers","version":1},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-07-13T01:56:20.542865Z"},"links":{"citing_paper":"/paper/2607.09590"},"observation_digest":"sha256:2773bc6ef769ccc2a16aa3c77014ba4969e50a1201e4de95321d2d720897556d","observation_id":"5f5a9c03-5e1d-4e1e-a6cb-8277cbbd064b","resolution":{"observed_at":"2026-07-13T01:56:20.542865Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2009.12293","last_updated":"2025-01-18T02:57:38Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2020-09-25T15:32:31Z","title":"robosuite: A Modular Simulation Framework and Benchmark for Robot Learning","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2009.12293","snapshot_observed_at":"2026-07-13T01:56:20.542865Z","title":"robosuite: A modular simulation framework and benchmark for robot learning,","venue":null,"work_id":null,"year":2009},"citing_paper":{"arxiv_id":"2607.09590","last_updated":"2026-07-10T16:42:17Z","snapshot_observed_at":"2026-08-13T20:45:04.704835Z","submitted_at":"2026-07-10T16:42:17Z","title":"PAC-ACT: Post-training Actor-Critic for Action Chunking Transformers","version":1},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-07-13T01:56:20.542865Z"},"links":{"cited_paper":"/paper/2009.12293","citing_paper":"/paper/2607.09590"},"observation_digest":"sha256:3b3ac04cb3a928ab8c01f5c0c5429ee4c73b8fd10b37ace88142e5c305eb2476","observation_id":"fa16465c-9cd8-479a-afa6-57a00fce74ad","resolution":{"observed_at":"2026-07-13T01:56:20.542865Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-13T01:56:20.542865Z","title":"DeeR-VLA: Dynamic inference of multimodal large language models for efficient robot execution,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.09590","last_updated":"2026-07-10T16:42:17Z","snapshot_observed_at":"2026-08-13T20:45:04.704835Z","submitted_at":"2026-07-10T16:42:17Z","title":"PAC-ACT: Post-training Actor-Critic for Action Chunking Transformers","version":1},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-07-13T01:56:20.542865Z"},"links":{"citing_paper":"/paper/2607.09590"},"observation_digest":"sha256:69114459e5a83319698a177e9fcc942eb4860c7bb2b9adb87fe66ac5b904a960","observation_id":"3627a4af-7e70-427a-8c73-72316c825505","resolution":{"observed_at":"2026-07-13T01:56:20.542865Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"paper":{"arxiv_id":"2607.09590","last_updated":"2026-07-10T16:42:17Z","latest_version":1,"primary_category":"cs.RO","snapshot_observed_at":"2026-08-13T20:45:04.704835Z","submitted_at":"2026-07-10T16:42:17Z","title":"PAC-ACT: Post-training Actor-Critic for Action Chunking Transformers"},"reference_resolution":{"displayed":32,"state_counts":{"malformed_identifier":1,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":30,"verified_exact":1,"verified_fuzzy":0},"total_outbound_references":32},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"thesis":"As of 18 August 2026, this Paper Citation Record lists 32 of 32 outbound references and 0 inbound Pith citation observations for arXiv:2607.09590."}