{"as_of":"2026-08-15T23:55:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:aa6b8bed06b0f0f40d95b1d174f85babfd2c5e1a8d68772ca990e417cbb5dd9b","coverage":[{"denominator":31,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":31,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-11T11:20:20.073159Z","state":"measured"},{"denominator":31,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":31,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-15T06:32:42.880941+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2608.09762/citation-record","integrity":"/paper/2608.09762/integrity","json":"/paper/2608.09762/citation-record.json","paper":"/paper/2608.09762"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T11:20:19.874750Z","title":"A review of learning-based dynamics models for robotic manipulation |Science Robotics","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.09762","last_updated":"2026-08-10T15:54:25Z","snapshot_observed_at":"2026-08-15T03:59:44.173644Z","submitted_at":"2026-08-10T15:54:25Z","title":"Efficient Real-World Online Reinforcement Learning for Robot Manipulation via Centralized Training and Critic Decomposition","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-11T11:20:19.874750Z"},"links":{"citing_paper":"/paper/2608.09762"},"observation_digest":"sha256:790718bb380ce65d695b3ea4150274e041b3bc1b40624f1f35eda55fbedbf695","observation_id":"7953fa82-b810-499b-bb1c-efcf13a82c01","resolution":{"observed_at":"2026-08-11T11:20:19.874750Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T11:20:21.187103Z","title":"Learning Con- tinuous Control Actions for Robotic Grasping with Reinforcement Learning,","venue":null,"work_id":"d563444d-7270-4d52-864d-0717126e5d4b","year":2020},"citing_paper":{"arxiv_id":"2608.09762","last_updated":"2026-08-10T15:54:25Z","snapshot_observed_at":"2026-08-15T03:59:44.173644Z","submitted_at":"2026-08-10T15:54:25Z","title":"Efficient Real-World Online Reinforcement Learning for Robot Manipulation via Centralized Training and Critic Decomposition","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-11T11:20:19.881716Z"},"links":{"citing_paper":"/paper/2608.09762"},"observation_digest":"sha256:5f4cca05bbdf76e37ef01f0e0682a36ebc3693360cdfb0ad40ad0a33e24a68a8","observation_id":"4f175a95-4231-4d2c-8106-761b11c7705a","resolution":{"observed_at":"2026-08-11T11:20:21.194190Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"ument/1038845","doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T11:20:20.842549Z","title":"General- Purpose Sim2Real Protocol for Learning Contact-Rich Manipulation With Marker-Based Visuotactile Sensors,","venue":null,"work_id":"20480121-cca2-4f88-9541-9eae54666629","year":2024},"citing_paper":{"arxiv_id":"2608.09762","last_updated":"2026-08-10T15:54:25Z","snapshot_observed_at":"2026-08-15T03:59:44.173644Z","submitted_at":"2026-08-10T15:54:25Z","title":"Efficient Real-World Online Reinforcement Learning for Robot Manipulation via Centralized Training and Critic Decomposition","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-11T11:20:19.889277Z"},"links":{"citing_paper":"/paper/2608.09762"},"observation_digest":"sha256:6d1209420f3b94a247548f667443e2cf736e6aa379f816666ebe58149d64cd29","observation_id":"d0cd25a3-7530-46ae-af01-50fc90390d03","resolution":{"observed_at":"2026-08-11T11:20:20.852697Z","resolver_source":"raw_fallback","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2509.06342","last_updated":"2026-07-31T11:13:35Z","snapshot_observed_at":"2026-08-15T16:15:08.275621Z","submitted_at":"2025-09-08T05:32:28Z","title":"Towards bridging the gap: Systematic sim-to-real transfer for diverse legged robots","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2509.06342","snapshot_observed_at":"2026-08-11T11:20:19.895124Z","title":"Towards bridging the gap: Systematic sim-to-real transfer for diverse legged robots,","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2608.09762","last_updated":"2026-08-10T15:54:25Z","snapshot_observed_at":"2026-08-15T03:59:44.173644Z","submitted_at":"2026-08-10T15:54:25Z","title":"Efficient Real-World Online Reinforcement Learning for Robot Manipulation via Centralized Training and Critic Decomposition","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-11T11:20:19.895124Z"},"links":{"cited_paper":"/paper/2509.06342","citing_paper":"/paper/2608.09762"},"observation_digest":"sha256:fd31d88108e073057590e2fffcbfdb7861b23dbc9f54a01feb28347401e0b3d5","observation_id":"3eac9bce-f94b-4229-a64e-e3e40b92467d","resolution":{"observed_at":"2026-08-11T11:20:19.895124Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T11:20:21.152926Z","title":"Srl-vic: A variable stiffness-based safe reinforcement learning for contact-rich robotic tasks,","venue":null,"work_id":"08f5a58e-dd53-4b3b-bf00-42d7bf87e25d","year":2024},"citing_paper":{"arxiv_id":"2608.09762","last_updated":"2026-08-10T15:54:25Z","snapshot_observed_at":"2026-08-15T03:59:44.173644Z","submitted_at":"2026-08-10T15:54:25Z","title":"Efficient Real-World Online Reinforcement Learning for Robot Manipulation via Centralized Training and Critic Decomposition","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-11T11:20:19.901989Z"},"links":{"citing_paper":"/paper/2608.09762"},"observation_digest":"sha256:c5c99a64aa6fbd11e438932e75de7ab4121fc3c01c42f0422d9fad0d16aee8fa","observation_id":"13405272-286b-4dc9-b277-7b1d07376018","resolution":{"observed_at":"2026-08-11T11:20:21.160147Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T11:20:19.907467Z","title":"Deep reinforcement learning for robotics: A survey of real-world successes,","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2608.09762","last_updated":"2026-08-10T15:54:25Z","snapshot_observed_at":"2026-08-15T03:59:44.173644Z","submitted_at":"2026-08-10T15:54:25Z","title":"Efficient Real-World Online Reinforcement Learning for Robot Manipulation via Centralized Training and Critic Decomposition","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-11T11:20:19.907467Z"},"links":{"citing_paper":"/paper/2608.09762"},"observation_digest":"sha256:5b5b47ade76ecb74c48d2a9cfea70428394c10447903b9dd6dbad65617501909","observation_id":"95e6ccef-cb1e-475c-8382-cf36fc8ff216","resolution":{"observed_at":"2026-08-11T11:20:19.907467Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T11:20:21.114313Z","title":"Improving vision-language-action model with online reinforcement learning,","venue":null,"work_id":"7eefdbfd-813b-4255-894c-ecce9985299a","year":2025},"citing_paper":{"arxiv_id":"2608.09762","last_updated":"2026-08-10T15:54:25Z","snapshot_observed_at":"2026-08-15T03:59:44.173644Z","submitted_at":"2026-08-10T15:54:25Z","title":"Efficient Real-World Online Reinforcement Learning for Robot Manipulation via Centralized Training and Critic Decomposition","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-11T11:20:19.913331Z"},"links":{"citing_paper":"/paper/2608.09762"},"observation_digest":"sha256:4c3ee595a18952b8ee6c634dfcd97b31d9b2672bf50990a9145ea22c9f67509a","observation_id":"ee437a5f-e70d-4f2a-be11-d2916a6e6eee","resolution":{"observed_at":"2026-08-11T11:20:21.121932Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2604.21741","last_updated":"2026-05-05T16:01:35Z","snapshot_observed_at":"2026-07-29T22:30:00.899443Z","submitted_at":"2026-04-23T14:42:54Z","title":"Hi-WM: Human-in-the-World-Model for Scalable Robot Post-Training","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2604.21741","snapshot_observed_at":"2026-08-11T11:20:19.919454Z","title":"Hi-wm: Human-in-the-world-model for scalable robot post-training,","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2608.09762","last_updated":"2026-08-10T15:54:25Z","snapshot_observed_at":"2026-08-15T03:59:44.173644Z","submitted_at":"2026-08-10T15:54:25Z","title":"Efficient Real-World Online Reinforcement Learning for Robot Manipulation via Centralized Training and Critic Decomposition","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-11T11:20:19.919454Z"},"links":{"cited_paper":"/paper/2604.21741","citing_paper":"/paper/2608.09762"},"observation_digest":"sha256:c77e2578b84054340c17825fd8aab50ab11329036b6cb230c177e74d1fa62ac5","observation_id":"ae2eab6f-486a-4215-bef2-fd81a99c225d","resolution":{"observed_at":"2026-08-11T11:20:19.919454Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T11:20:19.924795Z","title":"Rl-100: Performant robotic manipulation with real-world reinforcement learning,","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2608.09762","last_updated":"2026-08-10T15:54:25Z","snapshot_observed_at":"2026-08-15T03:59:44.173644Z","submitted_at":"2026-08-10T15:54:25Z","title":"Efficient Real-World Online Reinforcement Learning for Robot Manipulation via Centralized Training and Critic Decomposition","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-11T11:20:19.924795Z"},"links":{"citing_paper":"/paper/2608.09762"},"observation_digest":"sha256:b8a15c51fcf4bbe9f66491f7488736cc5208151c719cfa762f9ec5b7a2cfd16d","observation_id":"2bab35a4-89e1-4c86-b096-dcf22b84ad41","resolution":{"observed_at":"2026-08-11T11:20:19.924795Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T11:20:19.930023Z","title":"Rlinf-user: A unified and extensible system for real-world online policy learning in embodied ai,","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2608.09762","last_updated":"2026-08-10T15:54:25Z","snapshot_observed_at":"2026-08-15T03:59:44.173644Z","submitted_at":"2026-08-10T15:54:25Z","title":"Efficient Real-World Online Reinforcement Learning for Robot Manipulation via Centralized Training and Critic Decomposition","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-11T11:20:19.930023Z"},"links":{"citing_paper":"/paper/2608.09762"},"observation_digest":"sha256:b1da0e616e6b7ecba7120f59d30c14d0bcb4fae2f5126a04bfd2345a6b30e962","observation_id":"96e95e0a-14ed-41b8-afe7-ff5c1cc4a317","resolution":{"observed_at":"2026-08-11T11:20:19.930023Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"ocument/1108004","doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T11:20:20.442687Z","title":"Towards Autonomous Reinforcement Learning for Real-World Robotic Manipulation With Large Language Models,","venue":null,"work_id":"16220c35-f72f-48b2-907c-4b303f8b5a36","year":2025},"citing_paper":{"arxiv_id":"2608.09762","last_updated":"2026-08-10T15:54:25Z","snapshot_observed_at":"2026-08-15T03:59:44.173644Z","submitted_at":"2026-08-10T15:54:25Z","title":"Efficient Real-World Online Reinforcement Learning for Robot Manipulation via Centralized Training and Critic Decomposition","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-11T11:20:19.935620Z"},"links":{"citing_paper":"/paper/2608.09762"},"observation_digest":"sha256:7ea4738bb43737ae819a6505b83c9941ff0ba24d839264e7cda44ef90a9c9fd1","observation_id":"dca26e27-0d33-4020-bab7-77c33600fa49","resolution":{"observed_at":"2026-08-11T11:20:20.456064Z","resolver_source":"raw_fallback","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T11:20:19.942026Z","title":"Serl: A software suite for sample- efficient robotic reinforcement learning,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2608.09762","last_updated":"2026-08-10T15:54:25Z","snapshot_observed_at":"2026-08-15T03:59:44.173644Z","submitted_at":"2026-08-10T15:54:25Z","title":"Efficient Real-World Online Reinforcement Learning for Robot Manipulation via Centralized Training and Critic Decomposition","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-11T11:20:19.942026Z"},"links":{"citing_paper":"/paper/2608.09762"},"observation_digest":"sha256:f303653c9a575cf86b88248b9f19861047ffb9371e0008fd402f7de63b47ff43","observation_id":"d314379b-deee-43a2-aa96-5c385f267da2","resolution":{"observed_at":"2026-08-11T11:20:19.942026Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T11:20:19.947525Z","title":"Precise and dexterous robotic manipulation via human-in-the-loop reinforcement learning,","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2608.09762","last_updated":"2026-08-10T15:54:25Z","snapshot_observed_at":"2026-08-15T03:59:44.173644Z","submitted_at":"2026-08-10T15:54:25Z","title":"Efficient Real-World Online Reinforcement Learning for Robot Manipulation via Centralized Training and Critic Decomposition","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-11T11:20:19.947525Z"},"links":{"citing_paper":"/paper/2608.09762"},"observation_digest":"sha256:c3f204548f3eccb771438d5b72ca46effe9cc207f4f763a27879d764c75433c0","observation_id":"b6fd6e15-207f-490b-b2ad-28e8b8d3db58","resolution":{"observed_at":"2026-08-11T11:20:19.947525Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2505.18719","last_updated":"2025-05-24T14:42:51Z","snapshot_observed_at":"2026-08-14T01:02:35.686274Z","submitted_at":"2025-05-24T14:42:51Z","title":"VLA-RL: Towards Masterful and General Robotic Manipulation with Scalable Reinforcement Learning","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2505.18719","snapshot_observed_at":"2026-08-11T11:20:19.953071Z","title":"Vla-rl: Towards masterful and general robotic ma- nipulation with scalable reinforcement learning,","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2608.09762","last_updated":"2026-08-10T15:54:25Z","snapshot_observed_at":"2026-08-15T03:59:44.173644Z","submitted_at":"2026-08-10T15:54:25Z","title":"Efficient Real-World Online Reinforcement Learning for Robot Manipulation via Centralized Training and Critic Decomposition","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-11T11:20:19.953071Z"},"links":{"cited_paper":"/paper/2505.18719","citing_paper":"/paper/2608.09762"},"observation_digest":"sha256:3b9d8fa90029fbc3ff56546b5a1ed4ee3acae9b7e20ae15a2f16115f1a90b38f","observation_id":"8fe47e55-fee9-49fc-b126-586f27ee244d","resolution":{"observed_at":"2026-08-11T11:20:19.953071Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T11:20:21.067538Z","title":"Reinflow: Fine-tuning flow matching policy with online reinforcement learning,","venue":null,"work_id":"f09639fa-774c-44bd-a55d-8a0b883ec1b5","year":2026},"citing_paper":{"arxiv_id":"2608.09762","last_updated":"2026-08-10T15:54:25Z","snapshot_observed_at":"2026-08-15T03:59:44.173644Z","submitted_at":"2026-08-10T15:54:25Z","title":"Efficient Real-World Online Reinforcement Learning for Robot Manipulation via Centralized Training and Critic Decomposition","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-11T11:20:19.958730Z"},"links":{"citing_paper":"/paper/2608.09762"},"observation_digest":"sha256:cf2b0cbc20454063b2f16223301fc8cad6558e7261b86ea71802efe2736a20be","observation_id":"22e82f08-1792-4285-9c83-703042f22bcf","resolution":{"observed_at":"2026-08-11T11:20:21.073542Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T11:20:21.046042Z","title":"Hybrid reward architecture for reinforcement learning,","venue":null,"work_id":"1f112b8a-c7f9-449d-82ee-d7722051089a","year":2017},"citing_paper":{"arxiv_id":"2608.09762","last_updated":"2026-08-10T15:54:25Z","snapshot_observed_at":"2026-08-15T03:59:44.173644Z","submitted_at":"2026-08-10T15:54:25Z","title":"Efficient Real-World Online Reinforcement Learning for Robot Manipulation via Centralized Training and Critic Decomposition","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-11T11:20:19.968287Z"},"links":{"citing_paper":"/paper/2608.09762"},"observation_digest":"sha256:cdd0dc53daf0cf6bee7ce74854d4b2cdf6203baebdb46a650572b3707a37ded7","observation_id":"61f3d213-e333-428e-8051-c675de64a402","resolution":{"observed_at":"2026-08-11T11:20:21.053010Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T11:20:19.974107Z","title":"Efficient online reinforcement learning with offline data,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2608.09762","last_updated":"2026-08-10T15:54:25Z","snapshot_observed_at":"2026-08-15T03:59:44.173644Z","submitted_at":"2026-08-10T15:54:25Z","title":"Efficient Real-World Online Reinforcement Learning for Robot Manipulation via Centralized Training and Critic Decomposition","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-11T11:20:19.974107Z"},"links":{"citing_paper":"/paper/2608.09762"},"observation_digest":"sha256:098ed6ae0db436786cc1c24a4450cdc06e9256e21abf2b586a3a059f90508cc5","observation_id":"0142220e-b7b5-49fc-8fe4-3080dc7f2d20","resolution":{"observed_at":"2026-08-11T11:20:19.974107Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1511.04143","last_updated":"2024-05-03T15:00:50Z","snapshot_observed_at":"2026-08-14T22:23:10.894196Z","submitted_at":"2015-11-13T02:34:33Z","title":"Deep Reinforcement Learning in Parameterized Action Space","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1511.04143","snapshot_observed_at":"2026-08-11T11:20:19.980036Z","title":"Deep reinforcement learning in param- eterized action space,","venue":null,"work_id":null,"year":2015},"citing_paper":{"arxiv_id":"2608.09762","last_updated":"2026-08-10T15:54:25Z","snapshot_observed_at":"2026-08-15T03:59:44.173644Z","submitted_at":"2026-08-10T15:54:25Z","title":"Efficient Real-World Online Reinforcement Learning for Robot Manipulation via Centralized Training and Critic Decomposition","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-11T11:20:19.980036Z"},"links":{"cited_paper":"/paper/1511.04143","citing_paper":"/paper/2608.09762"},"observation_digest":"sha256:618dc4a02ae798e4b7bbdbcd0c2274e6f600455afd084edfcacc320bbb8cac24","observation_id":"df969530-88a0-45bf-8ae8-eb2b1f682f6d","resolution":{"observed_at":"2026-08-11T11:20:19.980036Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1810.06394","last_updated":"2018-10-10T07:38:44Z","snapshot_observed_at":"2026-08-14T18:16:55.156411Z","submitted_at":"2018-10-10T07:38:44Z","title":"Parametrized Deep Q-Networks Learning: Reinforcement Learning with Discrete-Continuous Hybrid Action Space","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1810.06394","snapshot_observed_at":"2026-08-11T11:20:19.985496Z","title":"Parametrized deep q-networks learning: Reinforcement learning with discrete-continuous hybrid action space,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.09762","last_updated":"2026-08-10T15:54:25Z","snapshot_observed_at":"2026-08-15T03:59:44.173644Z","submitted_at":"2026-08-10T15:54:25Z","title":"Efficient Real-World Online Reinforcement Learning for Robot Manipulation via Centralized Training and Critic Decomposition","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-11T11:20:19.985496Z"},"links":{"cited_paper":"/paper/1810.06394","citing_paper":"/paper/2608.09762"},"observation_digest":"sha256:9a2aeab2b7099881f7681c8da03f24115f41feaeed734634d11dc95da8e7a31b","observation_id":"f8be1923-6991-4df6-864a-890db2122199","resolution":{"observed_at":"2026-08-11T11:20:19.985496Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1905.04388","last_updated":"2019-05-10T21:57:41Z","snapshot_observed_at":"2026-08-14T16:34:03.114602Z","submitted_at":"2019-05-10T21:57:41Z","title":"Multi-Pass Q-Networks for Deep Reinforcement Learning with Parameterised Action Spaces","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1905.04388","snapshot_observed_at":"2026-08-11T11:20:19.998476Z","title":"Multi-pass q-networks for deep reinforcement learning with parameterised action spaces,","venue":null,"work_id":null,"year":1905},"citing_paper":{"arxiv_id":"2608.09762","last_updated":"2026-08-10T15:54:25Z","snapshot_observed_at":"2026-08-15T03:59:44.173644Z","submitted_at":"2026-08-10T15:54:25Z","title":"Efficient Real-World Online Reinforcement Learning for Robot Manipulation via Centralized Training and Critic Decomposition","version":1},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-11T11:20:19.998476Z"},"links":{"cited_paper":"/paper/1905.04388","citing_paper":"/paper/2608.09762"},"observation_digest":"sha256:bb718abb719392dd9c035d69e1c1daccf7587c2fdddc6b25a9ff521e77113df3","observation_id":"fe4d146d-8b36-413d-9a1c-539d15bd0047","resolution":{"observed_at":"2026-08-11T11:20:19.998476Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T11:20:20.006679Z","title":"Multi-agent actor-critic for mixed cooperative-competitive environments,","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2608.09762","last_updated":"2026-08-10T15:54:25Z","snapshot_observed_at":"2026-08-15T03:59:44.173644Z","submitted_at":"2026-08-10T15:54:25Z","title":"Efficient Real-World Online Reinforcement Learning for Robot Manipulation via Centralized Training and Critic Decomposition","version":1},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-11T11:20:20.006679Z"},"links":{"citing_paper":"/paper/2608.09762"},"observation_digest":"sha256:eb2fc0f8402565b14cc45805b5d1b836434d5618fb36eeed15a8b85a8d384aea","observation_id":"8a078d8e-7ac0-4a00-8fc4-eb2c7f5db353","resolution":{"observed_at":"2026-08-11T11:20:20.006679Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T11:20:20.012254Z","title":"The surprising effectiveness of ppo in cooperative multi-agent games,","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2608.09762","last_updated":"2026-08-10T15:54:25Z","snapshot_observed_at":"2026-08-15T03:59:44.173644Z","submitted_at":"2026-08-10T15:54:25Z","title":"Efficient Real-World Online Reinforcement Learning for Robot Manipulation via Centralized Training and Critic Decomposition","version":1},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-11T11:20:20.012254Z"},"links":{"citing_paper":"/paper/2608.09762"},"observation_digest":"sha256:44099a49491e25c981a3fae7100f565cdcbe96a93990989eeb081193c63e4c8a","observation_id":"36ffc7a6-71f5-4857-84c9-17b733237f35","resolution":{"observed_at":"2026-08-11T11:20:20.012254Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T11:20:20.975570Z","title":"Asynchronous actor-critic for multi-agent reinforcement learning,","venue":null,"work_id":"750872f4-63eb-479a-88b9-d3a3d91889cc","year":2022},"citing_paper":{"arxiv_id":"2608.09762","last_updated":"2026-08-10T15:54:25Z","snapshot_observed_at":"2026-08-15T03:59:44.173644Z","submitted_at":"2026-08-10T15:54:25Z","title":"Efficient Real-World Online Reinforcement Learning for Robot Manipulation via Centralized Training and Critic Decomposition","version":1},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-11T11:20:20.021539Z"},"links":{"citing_paper":"/paper/2608.09762"},"observation_digest":"sha256:02fe7bed1c0201ee4bb6fd093c8bc04d7a0d8aaaa4e6cf78d8c6b17743ba7e8f","observation_id":"55b51ff4-6707-4e05-9489-6b5836aefa71","resolution":{"observed_at":"2026-08-11T11:20:20.985986Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T11:20:20.950617Z","title":"Action decoupled sac reinforcement learning with discrete-continuous hybrid action spaces,","venue":null,"work_id":"9b94e96a-79c6-461b-9652-e3b278875f3b","year":2023},"citing_paper":{"arxiv_id":"2608.09762","last_updated":"2026-08-10T15:54:25Z","snapshot_observed_at":"2026-08-15T03:59:44.173644Z","submitted_at":"2026-08-10T15:54:25Z","title":"Efficient Real-World Online Reinforcement Learning for Robot Manipulation via Centralized Training and Critic Decomposition","version":1},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-11T11:20:20.027981Z"},"links":{"citing_paper":"/paper/2608.09762"},"observation_digest":"sha256:b95a5f4f63242f213afb5887bbe59bced68713e79ea8f32826b0ba511ec26c60","observation_id":"5d5e5942-bb6d-414a-812b-bd687254c0a5","resolution":{"observed_at":"2026-08-11T11:20:20.956233Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T11:20:20.928325Z","title":"Effective multi-agent deep reinforcement learning control with relative entropy regularization,","venue":null,"work_id":"3005ecbf-b1b1-42a8-99cb-ba46ab7c852d","year":2024},"citing_paper":{"arxiv_id":"2608.09762","last_updated":"2026-08-10T15:54:25Z","snapshot_observed_at":"2026-08-15T03:59:44.173644Z","submitted_at":"2026-08-10T15:54:25Z","title":"Efficient Real-World Online Reinforcement Learning for Robot Manipulation via Centralized Training and Critic Decomposition","version":1},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-08-11T11:20:20.036886Z"},"links":{"citing_paper":"/paper/2608.09762"},"observation_digest":"sha256:205d5c0a82b8e288e352eb9e7517ae0c42e8cda1b82179ddb0eef2bba342f24a","observation_id":"83659ad8-fe57-4c94-b34d-b03c64bccc8a","resolution":{"observed_at":"2026-08-11T11:20:20.934523Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1812.05905","last_updated":"2019-01-29T12:10:47Z","snapshot_observed_at":"2026-08-01T15:24:35.515954Z","submitted_at":"2018-12-13T04:44:29Z","title":"Soft Actor-Critic Algorithms and Applications","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1812.05905","snapshot_observed_at":"2026-08-11T11:20:20.042024Z","title":"Soft actor-critic algorithms and applications. arxiv 2018,","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2608.09762","last_updated":"2026-08-10T15:54:25Z","snapshot_observed_at":"2026-08-15T03:59:44.173644Z","submitted_at":"2026-08-10T15:54:25Z","title":"Efficient Real-World Online Reinforcement Learning for Robot Manipulation via Centralized Training and Critic Decomposition","version":1},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-08-11T11:20:20.042024Z"},"links":{"cited_paper":"/paper/1812.05905","citing_paper":"/paper/2608.09762"},"observation_digest":"sha256:aec16389ca4c05fa24f760a25e6f8ee7c1e2979adc3dbf50afe3c450a5aef86e","observation_id":"e5eeae7a-6621-4cf4-a573-156865f8c01e","resolution":{"observed_at":"2026-08-11T11:20:20.042024Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T11:20:20.048651Z","title":"Deep residual learning for image recognition,","venue":null,"work_id":null,"year":2016},"citing_paper":{"arxiv_id":"2608.09762","last_updated":"2026-08-10T15:54:25Z","snapshot_observed_at":"2026-08-15T03:59:44.173644Z","submitted_at":"2026-08-10T15:54:25Z","title":"Efficient Real-World Online Reinforcement Learning for Robot Manipulation via Centralized Training and Critic Decomposition","version":1},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-08-11T11:20:20.048651Z"},"links":{"citing_paper":"/paper/2608.09762"},"observation_digest":"sha256:25fd90ebf9c42f13fa3f718239e01f925b066492d7bb56d642ce85d35aba7857","observation_id":"f2cabc70-02ae-44eb-b8ae-be067ec5d036","resolution":{"observed_at":"2026-08-11T11:20:20.048651Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2409.03052","last_updated":"2024-09-04T19:54:40Z","snapshot_observed_at":"2026-08-12T22:51:14.103500Z","submitted_at":"2024-09-04T19:54:40Z","title":"An Introduction to Centralized Training for Decentralized Execution in Cooperative Multi-Agent Reinforcement Learning","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2409.03052","snapshot_observed_at":"2026-08-11T11:20:20.055396Z","title":"An introduction to centralized training for decentralized execution in cooperative multi-agent reinforcement learning,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2608.09762","last_updated":"2026-08-10T15:54:25Z","snapshot_observed_at":"2026-08-15T03:59:44.173644Z","submitted_at":"2026-08-10T15:54:25Z","title":"Efficient Real-World Online Reinforcement Learning for Robot Manipulation via Centralized Training and Critic Decomposition","version":1},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-08-11T11:20:20.055396Z"},"links":{"cited_paper":"/paper/2409.03052","citing_paper":"/paper/2608.09762"},"observation_digest":"sha256:01e82e98dd3f8fe27f7b21e09a91a46e974d59e4fc5fe0a6cc31fe7a12c190bf","observation_id":"5074cb71-2bf8-4341-9c92-132d71c9fe2e","resolution":{"observed_at":"2026-08-11T11:20:20.055396Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1910.07207","last_updated":"2019-10-18T09:17:44Z","snapshot_observed_at":"2026-08-14T00:35:36.804755Z","submitted_at":"2019-10-16T08:11:08Z","title":"Soft Actor-Critic for Discrete Action Settings","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1910.07207","snapshot_observed_at":"2026-08-11T11:20:20.061953Z","title":"Soft actor-critic for discrete action settings,","venue":null,"work_id":null,"year":1910},"citing_paper":{"arxiv_id":"2608.09762","last_updated":"2026-08-10T15:54:25Z","snapshot_observed_at":"2026-08-15T03:59:44.173644Z","submitted_at":"2026-08-10T15:54:25Z","title":"Efficient Real-World Online Reinforcement Learning for Robot Manipulation via Centralized Training and Critic Decomposition","version":1},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-08-11T11:20:20.061953Z"},"links":{"cited_paper":"/paper/1910.07207","citing_paper":"/paper/2608.09762"},"observation_digest":"sha256:7d877c8fdc8fe2d7d1189105784313e62f1de09d1de479b88ad9303e78a9facd","observation_id":"641735f2-9b57-48e6-98be-efa0f519e538","resolution":{"observed_at":"2026-08-11T11:20:20.061953Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T11:20:20.887977Z","title":"A high-force gripper with embedded multimodal sensing for powerful and perception driven grasping,","venue":null,"work_id":"4056cf81-b70d-445d-8094-0988fa4a7436","year":2024},"citing_paper":{"arxiv_id":"2608.09762","last_updated":"2026-08-10T15:54:25Z","snapshot_observed_at":"2026-08-15T03:59:44.173644Z","submitted_at":"2026-08-10T15:54:25Z","title":"Efficient Real-World Online Reinforcement Learning for Robot Manipulation via Centralized Training and Critic Decomposition","version":1},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-08-11T11:20:20.067472Z"},"links":{"citing_paper":"/paper/2608.09762"},"observation_digest":"sha256:26ef3f6ae9a8dbec465c148147bd1c990298f81dbd9dfe99ab3ceb5a9fb16f37","observation_id":"c43875eb-ce6b-4761-a192-06de815cc0a2","resolution":{"observed_at":"2026-08-11T11:20:20.894818Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T11:20:20.073159Z","title":"Root mean square layer normalization,","venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2608.09762","last_updated":"2026-08-10T15:54:25Z","snapshot_observed_at":"2026-08-15T03:59:44.173644Z","submitted_at":"2026-08-10T15:54:25Z","title":"Efficient Real-World Online Reinforcement Learning for Robot Manipulation via Centralized Training and Critic Decomposition","version":1},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-08-11T11:20:20.073159Z"},"links":{"citing_paper":"/paper/2608.09762"},"observation_digest":"sha256:ebfa4482fe62d65ecbca752651232da02f24769fb42b3fc577b2a08db7e4faea","observation_id":"80032bd8-1fab-403b-ad4b-09aa3173a7e7","resolution":{"observed_at":"2026-08-11T11:20:20.073159Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"paper":{"arxiv_id":"2608.09762","last_updated":"2026-08-10T15:54:25Z","latest_version":1,"primary_category":"cs.RO","snapshot_observed_at":"2026-08-15T03:59:44.173644Z","submitted_at":"2026-08-10T15:54:25Z","title":"Efficient Real-World Online Reinforcement Learning for Robot Manipulation via Centralized Training and Critic Decomposition"},"reference_resolution":{"displayed":31,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":20,"verified_exact":2,"verified_fuzzy":9},"total_outbound_references":31},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"thesis":"As of 15 August 2026, this Paper Citation Record lists 31 of 31 outbound references and 0 inbound Pith citation observations for arXiv:2608.09762."}