{"as_of":"2026-08-14T08:26:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:61b7567a28a43effcafeaca2e09b23713566c72ecf5f47eab3ffa40f6adaf8a8","coverage":[{"denominator":50,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":50,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-06T19:05:23.096610Z","state":"measured"},{"denominator":52,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":52,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-14T06:32:32.682623+00:00","state":"measured"},{"denominator":2,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":2,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-02T00:57:42.384758Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"arxiv_reference","source_observed_at":"2026-05-10T08:32:52.200905Z","state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2507.06710","last_updated":"2025-07-13T06:32:40Z","snapshot_observed_at":"2026-08-11T21:37:25.462224Z","submitted_at":"2025-07-09T10:08:15Z","title":"Spatial-Temporal Aware Visuomotor Diffusion Policy Learning","version":2},"cited_work":{"arxiv_id":"2507.06710","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2507.06710","snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":null,"venue":null,"work_id":"a695d8da-2b41-4613-83c6-c56dd59ceb36","year":2025},"citing_paper":{"arxiv_id":"2604.15938","last_updated":"2026-04-17T10:56:59Z","snapshot_observed_at":"2026-07-31T03:34:07.969160Z","submitted_at":"2026-04-17T10:56:59Z","title":"VADF: Vision-Adaptive Diffusion Policy Framework for Efficient Robotic Manipulation","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-05-10T08:31:13.882275Z"},"links":{"cited_paper":"/paper/2507.06710","citing_paper":"/paper/2604.15938"},"observation_digest":"sha256:2a133b563df8fba34d8d1202205a3f8fefede9e376cc2d389d1aae003f9c0078","observation_id":"046e2022-f82b-403f-a99b-47f46f0a826b","resolution":{"observed_at":"2026-05-10T08:32:52.202593Z","resolver_source":"arxiv_id","status":"malformed_identifier"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2507.06710","last_updated":"2025-07-13T06:32:40Z","snapshot_observed_at":"2026-08-11T21:37:25.462224Z","submitted_at":"2025-07-09T10:08:15Z","title":"Spatial-Temporal Aware Visuomotor Diffusion Policy Learning","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2507.06710","snapshot_observed_at":"2026-08-02T00:57:42.384758Z","title":"Spatial- temporal aware visuomotor diffusion policy learning.arXiv preprint arXiv:2507.06710, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.14852","last_updated":"2026-07-21T06:49:06Z","snapshot_observed_at":"2026-08-14T00:59:25.150499Z","submitted_at":"2026-07-16T11:22:06Z","title":"Towards Human-like Physical Intelligence: Lifelong Vision-Language-Action Learning for Robotic Manipulation","version":2},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-08-02T00:57:42.384758Z"},"links":{"cited_paper":"/paper/2507.06710","citing_paper":"/paper/2607.14852"},"observation_digest":"sha256:75215a98889bd0607519bae60ecf603b9b5c5b9f1d06f016e8190ebe7a68c38f","observation_id":"ad0e677d-ee68-4ae8-b596-9ab348fca764","resolution":{"observed_at":"2026-08-02T00:57:42.384758Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"links":{"evidence":"/evidence","html":"/paper/2507.06710/citation-record","integrity":"/paper/2507.06710/integrity","json":"/paper/2507.06710/citation-record.json","paper":"/paper/2507.06710"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:05:24.153299Z","title":"Dexterous imitation made easy: A learning- based framework for efficient dexterous manipulation","venue":null,"work_id":"605df35a-c76a-4d85-abc8-8ae44fbdcf09","year":2023},"citing_paper":{"arxiv_id":"2507.06710","last_updated":"2025-07-13T06:32:40Z","snapshot_observed_at":"2026-08-11T21:37:25.462224Z","submitted_at":"2025-07-09T10:08:15Z","title":"Spatial-Temporal Aware Visuomotor Diffusion Policy Learning","version":2},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-06T19:05:22.809255Z"},"links":{"citing_paper":"/paper/2507.06710"},"observation_digest":"sha256:6f98b7e5a0956125c57da53e800f29c05d36535039c9a5bb4c3cfb4084a2de65","observation_id":"40bdbae0-1ef1-4345-99df-1ae9c991ac79","resolution":{"observed_at":"2026-08-06T19:05:24.158911Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:05:24.136573Z","title":"Dexart: Benchmarking generalizable dexterous manipu- lation with articulated objects","venue":null,"work_id":"8e5c325f-179e-41b2-93ef-7ea0ce1aa342","year":2023},"citing_paper":{"arxiv_id":"2507.06710","last_updated":"2025-07-13T06:32:40Z","snapshot_observed_at":"2026-08-11T21:37:25.462224Z","submitted_at":"2025-07-09T10:08:15Z","title":"Spatial-Temporal Aware Visuomotor Diffusion Policy Learning","version":2},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-06T19:05:22.814855Z"},"links":{"citing_paper":"/paper/2507.06710"},"observation_digest":"sha256:69d89aa0687911174b4e71a105d4804ff8ea681fe064fc5544303efe9c232439","observation_id":"b019af86-31a1-47cb-852a-ae4dc0df752b","resolution":{"observed_at":"2026-08-06T19:05:24.141932Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:05:24.120323Z","title":"Decision transformer: Reinforce- ment learning via sequence modeling","venue":null,"work_id":"99f32c69-e9bf-44ba-ba3c-d4c54bdfb189","year":2021},"citing_paper":{"arxiv_id":"2507.06710","last_updated":"2025-07-13T06:32:40Z","snapshot_observed_at":"2026-08-11T21:37:25.462224Z","submitted_at":"2025-07-09T10:08:15Z","title":"Spatial-Temporal Aware Visuomotor Diffusion Policy Learning","version":2},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-06T19:05:22.819883Z"},"links":{"citing_paper":"/paper/2507.06710"},"observation_digest":"sha256:a070abad8719e8a8d5c791633b2edd8e5eaa7dc316875a2b9578af46a7a7ccbd","observation_id":"78a5e56f-9e09-4979-8d46-8e7ffeb45f87","resolution":{"observed_at":"2026-08-06T19:05:24.125877Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:05:24.104629Z","title":"Dif- fusiondet: Diffusion model for object detection","venue":null,"work_id":"3797f3b6-859b-4ea6-876f-c6d29ba57262","year":2023},"citing_paper":{"arxiv_id":"2507.06710","last_updated":"2025-07-13T06:32:40Z","snapshot_observed_at":"2026-08-11T21:37:25.462224Z","submitted_at":"2025-07-09T10:08:15Z","title":"Spatial-Temporal Aware Visuomotor Diffusion Policy Learning","version":2},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-06T19:05:22.825362Z"},"links":{"citing_paper":"/paper/2507.06710"},"observation_digest":"sha256:9029d570bd62c6db7614b62775d681e035cebc78a5b946809bfdc53feab76f88","observation_id":"189a05ee-e880-4386-84ea-bcccaaecac51","resolution":{"observed_at":"2026-08-06T19:05:24.109363Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:05:24.088710Z","title":"Diffusion policy: Visuomotor policy learning via action dif- fusion","venue":null,"work_id":"2d0351d4-c916-4a43-a1c8-922336c9a507","year":2023},"citing_paper":{"arxiv_id":"2507.06710","last_updated":"2025-07-13T06:32:40Z","snapshot_observed_at":"2026-08-11T21:37:25.462224Z","submitted_at":"2025-07-09T10:08:15Z","title":"Spatial-Temporal Aware Visuomotor Diffusion Policy Learning","version":2},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-06T19:05:22.830763Z"},"links":{"citing_paper":"/paper/2507.06710"},"observation_digest":"sha256:70afa32050557f744e241a5688a498f9aa0fc7dfe79266ea38ca7022df4568ed","observation_id":"f3f2f70c-b6af-4eb1-a990-74b13835d53a","resolution":{"observed_at":"2026-08-06T19:05:24.093676Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:05:24.073062Z","title":"Bayesian imitation learning for end-to-end mo- bile manipulation","venue":null,"work_id":"03560649-05c1-463b-ac8f-f5dfc616d881","year":2022},"citing_paper":{"arxiv_id":"2507.06710","last_updated":"2025-07-13T06:32:40Z","snapshot_observed_at":"2026-08-11T21:37:25.462224Z","submitted_at":"2025-07-09T10:08:15Z","title":"Spatial-Temporal Aware Visuomotor Diffusion Policy Learning","version":2},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-06T19:05:22.835524Z"},"links":{"citing_paper":"/paper/2507.06710"},"observation_digest":"sha256:7b019dbc3df0ec89ada38f9a4b07df9d82de57631d91c42f100c55616327606d","observation_id":"dbbe5a32-467e-44ff-a236-2cf955d18f00","resolution":{"observed_at":"2026-08-06T19:05:24.078046Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:05:24.057226Z","title":"Implicit behavioral cloning","venue":null,"work_id":"d11dbf5b-5239-44eb-8072-79daeabecf49","year":2022},"citing_paper":{"arxiv_id":"2507.06710","last_updated":"2025-07-13T06:32:40Z","snapshot_observed_at":"2026-08-11T21:37:25.462224Z","submitted_at":"2025-07-09T10:08:15Z","title":"Spatial-Temporal Aware Visuomotor Diffusion Policy Learning","version":2},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-06T19:05:22.845767Z"},"links":{"citing_paper":"/paper/2507.06710"},"observation_digest":"sha256:ef1be9662574b2353483dfc3513cf7a6a3511870672e9dadfc5f15fb9b082b47","observation_id":"d102b93c-2f92-4221-879d-23e1c5ab3b5f","resolution":{"observed_at":"2026-08-06T19:05:24.062135Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:05:24.037208Z","title":"Recurrent world models facilitate policy evolution","venue":null,"work_id":"c9240bd7-40e3-4276-9c9f-caf7ff1f015c","year":2018},"citing_paper":{"arxiv_id":"2507.06710","last_updated":"2025-07-13T06:32:40Z","snapshot_observed_at":"2026-08-11T21:37:25.462224Z","submitted_at":"2025-07-09T10:08:15Z","title":"Spatial-Temporal Aware Visuomotor Diffusion Policy Learning","version":2},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-06T19:05:22.851896Z"},"links":{"citing_paper":"/paper/2507.06710"},"observation_digest":"sha256:0371938e866304897d052a77a34258093434aea153e466faf95cda776cb79952","observation_id":"ec8d57b8-1d2a-48ae-8003-cc323dd01b5b","resolution":{"observed_at":"2026-08-06T19:05:24.043074Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1912.01603","last_updated":"2020-03-17T17:10:58Z","snapshot_observed_at":"2026-08-09T02:21:17.479736Z","submitted_at":"2019-12-03T18:57:16Z","title":"Dream to Control: Learning Behaviors by Latent Imagination","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1912.01603","snapshot_observed_at":"2026-08-06T19:05:22.857011Z","title":"Dream to control: Learning behaviors by la- tent imagination","venue":null,"work_id":null,"year":1912},"citing_paper":{"arxiv_id":"2507.06710","last_updated":"2025-07-13T06:32:40Z","snapshot_observed_at":"2026-08-11T21:37:25.462224Z","submitted_at":"2025-07-09T10:08:15Z","title":"Spatial-Temporal Aware Visuomotor Diffusion Policy Learning","version":2},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-06T19:05:22.857011Z"},"links":{"cited_paper":"/paper/1912.01603","citing_paper":"/paper/2507.06710"},"observation_digest":"sha256:f56a7b9ada5212d846312349013653afffcf489159a77dcb1e9f9a9fdcf15b81","observation_id":"52a5574d-7060-449b-8a92-38fa1b4a07e6","resolution":{"observed_at":"2026-08-06T19:05:22.857011Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2010.02193","last_updated":"2022-02-12T20:01:53Z","snapshot_observed_at":"2026-08-02T12:02:13.904371Z","submitted_at":"2020-10-05T17:52:14Z","title":"Mastering Atari with Discrete World Models","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2010.02193","snapshot_observed_at":"2026-08-06T19:05:22.863439Z","title":"Mastering atari with discrete world models.arXiv preprint arXiv:2010.02193, 2020","venue":null,"work_id":null,"year":2010},"citing_paper":{"arxiv_id":"2507.06710","last_updated":"2025-07-13T06:32:40Z","snapshot_observed_at":"2026-08-11T21:37:25.462224Z","submitted_at":"2025-07-09T10:08:15Z","title":"Spatial-Temporal Aware Visuomotor Diffusion Policy Learning","version":2},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-06T19:05:22.863439Z"},"links":{"cited_paper":"/paper/2010.02193","citing_paper":"/paper/2507.06710"},"observation_digest":"sha256:829f506dad1b9c08840f5c389039c0f4b48a98ff84f9f4997076c12ba5187fea","observation_id":"140bdaf4-9e25-4aef-b1be-1a63f8edb186","resolution":{"observed_at":"2026-08-06T19:05:22.863439Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:05:24.020840Z","title":"Deep hierarchical planning from pixels","venue":null,"work_id":"2c742cdc-fa7d-4a1e-82cb-9de57c9a828e","year":null},"citing_paper":{"arxiv_id":"2507.06710","last_updated":"2025-07-13T06:32:40Z","snapshot_observed_at":"2026-08-11T21:37:25.462224Z","submitted_at":"2025-07-09T10:08:15Z","title":"Spatial-Temporal Aware Visuomotor Diffusion Policy Learning","version":2},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-06T19:05:22.869160Z"},"links":{"citing_paper":"/paper/2507.06710"},"observation_digest":"sha256:44b23a0ce9defce5f2d916a2ccd5df9d3f056b8962b4b85bd18092a506202433","observation_id":"6b769cef-9df1-4a85-a090-7b5ca7bd1267","resolution":{"observed_at":"2026-08-06T19:05:24.025471Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2303.01497","last_updated":"2023-03-02T18:57:38Z","snapshot_observed_at":"2026-08-13T12:33:14.374089Z","submitted_at":"2023-03-02T18:57:38Z","title":"Teach a Robot to FISH: Versatile Imitation from One Minute of Demonstrations","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2303.01497","snapshot_observed_at":"2026-08-06T19:05:22.876784Z","title":"Teach a robot to fish: Versatile imitation from one minute of demonstrations","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2507.06710","last_updated":"2025-07-13T06:32:40Z","snapshot_observed_at":"2026-08-11T21:37:25.462224Z","submitted_at":"2025-07-09T10:08:15Z","title":"Spatial-Temporal Aware Visuomotor Diffusion Policy Learning","version":2},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-06T19:05:22.876784Z"},"links":{"cited_paper":"/paper/2303.01497","citing_paper":"/paper/2507.06710"},"observation_digest":"sha256:185ffe10906138904126eee3dedf20a76a743fd037bddc157686dacdd93044f7","observation_id":"2e83b270-c4ed-4180-8dd7-543bac9ffbde","resolution":{"observed_at":"2026-08-06T19:05:22.876784Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2212.05749","last_updated":"2023-06-15T17:57:21Z","snapshot_observed_at":"2026-08-13T13:23:43.429158Z","submitted_at":"2022-12-12T07:59:31Z","title":"On Pre-Training for Visuo-Motor Control: Revisiting a Learning-from-Scratch Baseline","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2212.05749","snapshot_observed_at":"2026-08-06T19:05:22.883748Z","title":"On pre-training for visuo-motor control: Re- visiting a learning-from-scratch baseline","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2507.06710","last_updated":"2025-07-13T06:32:40Z","snapshot_observed_at":"2026-08-11T21:37:25.462224Z","submitted_at":"2025-07-09T10:08:15Z","title":"Spatial-Temporal Aware Visuomotor Diffusion Policy Learning","version":2},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-06T19:05:22.883748Z"},"links":{"cited_paper":"/paper/2212.05749","citing_paper":"/paper/2507.06710"},"observation_digest":"sha256:3880b29863cbe203a23dad92b7fc4abd9417678fbc229960259e2b2190cd8ac0","observation_id":"aba1e13d-b87a-491e-9070-c3a91ef1deb1","resolution":{"observed_at":"2026-08-06T19:05:22.883748Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:05:22.889716Z","title":"Video dif- fusion models","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2507.06710","last_updated":"2025-07-13T06:32:40Z","snapshot_observed_at":"2026-08-11T21:37:25.462224Z","submitted_at":"2025-07-09T10:08:15Z","title":"Spatial-Temporal Aware Visuomotor Diffusion Policy Learning","version":2},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-06T19:05:22.889716Z"},"links":{"citing_paper":"/paper/2507.06710"},"observation_digest":"sha256:342dabe0d560fff93e12dec36d1a2ea2da2342858e4fd2afc7fbb0aaa734fea3","observation_id":"c6dbbf63-d896-4bf7-b917-0fb91861c718","resolution":{"observed_at":"2026-08-06T19:05:22.889716Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:05:23.993412Z","title":"Model-based imitation learning for urban driving","venue":null,"work_id":"db495f78-6fc4-4acc-9a69-c0bcdc45a8ea","year":2022},"citing_paper":{"arxiv_id":"2507.06710","last_updated":"2025-07-13T06:32:40Z","snapshot_observed_at":"2026-08-11T21:37:25.462224Z","submitted_at":"2025-07-09T10:08:15Z","title":"Spatial-Temporal Aware Visuomotor Diffusion Policy Learning","version":2},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-06T19:05:22.894698Z"},"links":{"citing_paper":"/paper/2507.06710"},"observation_digest":"sha256:71aa8e0816ef949d98916622646ce4178696a12a14df9cb5f8795798159f2b7c","observation_id":"76c9f927-e42a-4bf5-bd6b-1e0477b43e3a","resolution":{"observed_at":"2026-08-06T19:05:23.998727Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2309.17080","last_updated":"2023-09-29T09:20:37Z","snapshot_observed_at":"2026-07-06T16:25:21.571679Z","submitted_at":"2023-09-29T09:20:37Z","title":"GAIA-1: A Generative World Model for Autonomous Driving","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2309.17080","snapshot_observed_at":"2026-08-06T19:05:22.899771Z","title":"Gaia-1: A generative world model for au- tonomous driving","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2507.06710","last_updated":"2025-07-13T06:32:40Z","snapshot_observed_at":"2026-08-11T21:37:25.462224Z","submitted_at":"2025-07-09T10:08:15Z","title":"Spatial-Temporal Aware Visuomotor Diffusion Policy Learning","version":2},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-06T19:05:22.899771Z"},"links":{"cited_paper":"/paper/2309.17080","citing_paper":"/paper/2507.06710"},"observation_digest":"sha256:523637e519984302b929d6c9e91abb7e557e92dabf89bdcc76ed4b1371d90db0","observation_id":"45d5829c-3782-498c-8b6c-7367b4315c8b","resolution":{"observed_at":"2026-08-06T19:05:22.899771Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:05:23.972416Z","title":"Rlbench: The robot learning benchmark & learning environment","venue":null,"work_id":"5b3ec09e-3ba1-4995-9dbd-61671075c8ca","year":2020},"citing_paper":{"arxiv_id":"2507.06710","last_updated":"2025-07-13T06:32:40Z","snapshot_observed_at":"2026-08-11T21:37:25.462224Z","submitted_at":"2025-07-09T10:08:15Z","title":"Spatial-Temporal Aware Visuomotor Diffusion Policy Learning","version":2},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-06T19:05:22.905882Z"},"links":{"citing_paper":"/paper/2507.06710"},"observation_digest":"sha256:e4f33701221c2d69d59aefb85839424e3d142ad4d5caf96f2924d47c5c444aa9","observation_id":"9f89b6e9-200f-44ec-88b8-4190af3bf9a6","resolution":{"observed_at":"2026-08-06T19:05:23.978023Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:05:23.953578Z","title":"Coarse-to-fine imitation learning: Robot ma- nipulation from a single demonstration","venue":null,"work_id":"27f44e73-1af8-4bea-89a1-2770e15849c8","year":2021},"citing_paper":{"arxiv_id":"2507.06710","last_updated":"2025-07-13T06:32:40Z","snapshot_observed_at":"2026-08-11T21:37:25.462224Z","submitted_at":"2025-07-09T10:08:15Z","title":"Spatial-Temporal Aware Visuomotor Diffusion Policy Learning","version":2},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-06T19:05:22.910890Z"},"links":{"citing_paper":"/paper/2507.06710"},"observation_digest":"sha256:a0b871f1dc519205a31c397ffd34966ced0363a886c14c238bd4deeff038e569","observation_id":"13ff178a-0771-4214-83b5-4bab3dd43569","resolution":{"observed_at":"2026-08-06T19:05:23.959661Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:05:22.915934Z","title":"3d gaussian splatting for real-time radiance field rendering","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2507.06710","last_updated":"2025-07-13T06:32:40Z","snapshot_observed_at":"2026-08-11T21:37:25.462224Z","submitted_at":"2025-07-09T10:08:15Z","title":"Spatial-Temporal Aware Visuomotor Diffusion Policy Learning","version":2},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-06T19:05:22.915934Z"},"links":{"citing_paper":"/paper/2507.06710"},"observation_digest":"sha256:20b97b8785508c1b0128e18d44984a84f94e6b4843a1593328fcb54067beb549","observation_id":"0dad6769-74c0-4990-99b9-e74453985789","resolution":{"observed_at":"2026-08-06T19:05:22.915934Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2406.09246","last_updated":"2024-09-05T19:46:34Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-06-13T15:46:55Z","title":"OpenVLA: An Open-Source Vision-Language-Action Model","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2406.09246","snapshot_observed_at":"2026-08-06T19:05:22.923094Z","title":"Openvla: An open-source vision-language-action model","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.06710","last_updated":"2025-07-13T06:32:40Z","snapshot_observed_at":"2026-08-11T21:37:25.462224Z","submitted_at":"2025-07-09T10:08:15Z","title":"Spatial-Temporal Aware Visuomotor Diffusion Policy Learning","version":2},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-06T19:05:22.923094Z"},"links":{"cited_paper":"/paper/2406.09246","citing_paper":"/paper/2507.06710"},"observation_digest":"sha256:fdd5197d36b00d1e0d1427488af54bc65c9636fc21e085736b391bd0f3287497","observation_id":"8cbfe0a9-2907-4cd1-8555-8168076b6e49","resolution":{"observed_at":"2026-08-06T19:05:22.923094Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:05:23.922970Z","title":"Gr-mg: Leveraging partially- annotated data via multi-modal goal-conditioned policy","venue":null,"work_id":"6cff763f-811e-40ca-8dca-8a6b0b5658c8","year":2025},"citing_paper":{"arxiv_id":"2507.06710","last_updated":"2025-07-13T06:32:40Z","snapshot_observed_at":"2026-08-11T21:37:25.462224Z","submitted_at":"2025-07-09T10:08:15Z","title":"Spatial-Temporal Aware Visuomotor Diffusion Policy Learning","version":2},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-06T19:05:22.928987Z"},"links":{"citing_paper":"/paper/2507.06710"},"observation_digest":"sha256:9aa05673f622749b313bc633f40918ed952a8d1b2bf99d26224b3cdd21ee3cfa","observation_id":"1f927ca1-3ae2-4cb4-b293-428cf7ba8f96","resolution":{"observed_at":"2026-08-06T19:05:23.927901Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2410.07864","last_updated":"2025-03-01T08:57:15Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-10-10T12:33:46Z","title":"RDT-1B: a Diffusion Foundation Model for Bimanual Manipulation","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2410.07864","snapshot_observed_at":"2026-08-06T19:05:22.934587Z","title":"Rdt-1b: a diffusion foundation model for bimanual manipu- lation","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.06710","last_updated":"2025-07-13T06:32:40Z","snapshot_observed_at":"2026-08-11T21:37:25.462224Z","submitted_at":"2025-07-09T10:08:15Z","title":"Spatial-Temporal Aware Visuomotor Diffusion Policy Learning","version":2},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-06T19:05:22.934587Z"},"links":{"cited_paper":"/paper/2410.07864","citing_paper":"/paper/2507.06710"},"observation_digest":"sha256:6c636edc1c3879b5deb675c3bfe7c09330730491f076446902e7e7cd1833bbb9","observation_id":"2aa3d729-62da-4e51-86db-8df1d1a14002","resolution":{"observed_at":"2026-08-06T19:05:22.934587Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:05:23.906246Z","title":"Manigaussian: Dynamic gaus- sian splatting for multi-task robotic manipulation","venue":null,"work_id":"83d0543c-9f8c-47ed-a026-3582eb2831f2","year":2024},"citing_paper":{"arxiv_id":"2507.06710","last_updated":"2025-07-13T06:32:40Z","snapshot_observed_at":"2026-08-11T21:37:25.462224Z","submitted_at":"2025-07-09T10:08:15Z","title":"Spatial-Temporal Aware Visuomotor Diffusion Policy Learning","version":2},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-06T19:05:22.940850Z"},"links":{"citing_paper":"/paper/2507.06710"},"observation_digest":"sha256:b44f1f7c868f6b8187246d097ecfbac85235db905278fb8cd763be484e7fd868","observation_id":"ee7d5098-e9f8-4d66-8df4-b5195c03abe9","resolution":{"observed_at":"2026-08-06T19:05:23.911148Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2108.03298","last_updated":"2021-09-25T00:37:01Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2021-08-06T20:48:30Z","title":"What Matters in Learning from Offline Human Demonstrations for Robot Manipulation","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2108.03298","snapshot_observed_at":"2026-08-06T19:05:22.945481Z","title":"What mat- ters in learning from offline human demonstrations for robot manipulation","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2507.06710","last_updated":"2025-07-13T06:32:40Z","snapshot_observed_at":"2026-08-11T21:37:25.462224Z","submitted_at":"2025-07-09T10:08:15Z","title":"Spatial-Temporal Aware Visuomotor Diffusion Policy Learning","version":2},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-06T19:05:22.945481Z"},"links":{"cited_paper":"/paper/2108.03298","citing_paper":"/paper/2507.06710"},"observation_digest":"sha256:87b0289d2bf741a17347ed99f419a81c1f1d837235e15fb1c372387c88f83f33","observation_id":"dba98471-0cc6-4704-9548-bb02e4741214","resolution":{"observed_at":"2026-08-06T19:05:22.945481Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2407.20109","last_updated":"2024-10-31T06:16:24Z","snapshot_observed_at":"2026-08-12T23:12:44.610913Z","submitted_at":"2024-07-29T15:36:42Z","title":"Diffusion-DICE: In-Sample Diffusion Guidance for Offline Reinforcement Learning","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2407.20109","snapshot_observed_at":"2026-08-06T19:05:22.950394Z","title":"Diffusion-dice: In-sample diffusion guid- ance for offline reinforcement learning","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.06710","last_updated":"2025-07-13T06:32:40Z","snapshot_observed_at":"2026-08-11T21:37:25.462224Z","submitted_at":"2025-07-09T10:08:15Z","title":"Spatial-Temporal Aware Visuomotor Diffusion Policy Learning","version":2},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-08-06T19:05:22.950394Z"},"links":{"cited_paper":"/paper/2407.20109","citing_paper":"/paper/2507.06710"},"observation_digest":"sha256:643ec960f4f60f232c37885e52fc90f67be2b47fc227609de8fa0f19a3845453","observation_id":"0fd6699f-2736-421d-a743-d7ea00731f54","resolution":{"observed_at":"2026-08-06T19:05:22.950394Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2004.00784","last_updated":"2020-07-21T00:59:24Z","snapshot_observed_at":"2026-08-10T20:40:29.635669Z","submitted_at":"2020-04-02T02:56:16Z","title":"Learning Agile Robotic Locomotion Skills by Imitating Animals","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2004.00784","snapshot_observed_at":"2026-08-06T19:05:22.955708Z","title":"Learning agile robotic locomotion skills by imitating animals","venue":null,"work_id":null,"year":2004},"citing_paper":{"arxiv_id":"2507.06710","last_updated":"2025-07-13T06:32:40Z","snapshot_observed_at":"2026-08-11T21:37:25.462224Z","submitted_at":"2025-07-09T10:08:15Z","title":"Spatial-Temporal Aware Visuomotor Diffusion Policy Learning","version":2},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-08-06T19:05:22.955708Z"},"links":{"cited_paper":"/paper/2004.00784","citing_paper":"/paper/2507.06710"},"observation_digest":"sha256:5d162308ad2a529940f35fa8da91cada73dd3ff961ca9ddfd37da31e01f0d496","observation_id":"69d2b0e8-ce36-4dcd-a3ae-c5d5ad740d81","resolution":{"observed_at":"2026-08-06T19:05:22.955708Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:05:23.887720Z","title":"Dexmv: Imitation learning for dexterous manipulation from human videos","venue":null,"work_id":"1aba16dd-5220-4a16-b3b1-9ea864e6dfce","year":2022},"citing_paper":{"arxiv_id":"2507.06710","last_updated":"2025-07-13T06:32:40Z","snapshot_observed_at":"2026-08-11T21:37:25.462224Z","submitted_at":"2025-07-09T10:08:15Z","title":"Spatial-Temporal Aware Visuomotor Diffusion Policy Learning","version":2},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-08-06T19:05:22.961156Z"},"links":{"citing_paper":"/paper/2507.06710"},"observation_digest":"sha256:6c3df340b0ff29e32282a846c0fb5566cafd52fc479f04c2a45d225f4d1e7d0b","observation_id":"be73476c-e88b-405b-8a43-c7eaa08dfb2d","resolution":{"observed_at":"2026-08-06T19:05:23.894738Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1709.10087","last_updated":"2018-06-26T13:31:37Z","snapshot_observed_at":"2026-07-06T06:01:51.192687Z","submitted_at":"2017-09-28T17:51:13Z","title":"Learning Complex Dexterous Manipulation with Deep Reinforcement Learning and Demonstrations","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1709.10087","snapshot_observed_at":"2026-08-06T19:05:22.967479Z","title":"Learning complex dexterous manipulation with deep reinforcement learning and demonstrations","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2507.06710","last_updated":"2025-07-13T06:32:40Z","snapshot_observed_at":"2026-08-11T21:37:25.462224Z","submitted_at":"2025-07-09T10:08:15Z","title":"Spatial-Temporal Aware Visuomotor Diffusion Policy Learning","version":2},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-08-06T19:05:22.967479Z"},"links":{"cited_paper":"/paper/1709.10087","citing_paper":"/paper/2507.06710"},"observation_digest":"sha256:09be94916738776bebb30cf8209f6db4c1a232bfe35fb687ea6137cad24a2a0f","observation_id":"186fcafb-bcba-4c27-a9f5-8effc120f8c8","resolution":{"observed_at":"2026-08-06T19:05:22.967479Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1707.06347","last_updated":"2017-08-28T09:20:06Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2017-07-20T02:32:33Z","title":"Proximal Policy Optimization Algorithms","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1707.06347","snapshot_observed_at":"2026-08-06T19:05:22.972562Z","title":"Proximal policy optimization algo- rithms","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2507.06710","last_updated":"2025-07-13T06:32:40Z","snapshot_observed_at":"2026-08-11T21:37:25.462224Z","submitted_at":"2025-07-09T10:08:15Z","title":"Spatial-Temporal Aware Visuomotor Diffusion Policy Learning","version":2},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-08-06T19:05:22.972562Z"},"links":{"cited_paper":"/paper/1707.06347","citing_paper":"/paper/2507.06710"},"observation_digest":"sha256:4ebabb539185122e5aa3b4d968e754f98eda9065192eff933d89e385a29cc560","observation_id":"f4285f4b-1607-4ba7-905a-3445b37d521c","resolution":{"observed_at":"2026-08-06T19:05:22.972562Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:05:23.864539Z","title":"Masked world models for visual control","venue":null,"work_id":"e848c294-1f43-4300-861a-de5f8e5dd8f1","year":2023},"citing_paper":{"arxiv_id":"2507.06710","last_updated":"2025-07-13T06:32:40Z","snapshot_observed_at":"2026-08-11T21:37:25.462224Z","submitted_at":"2025-07-09T10:08:15Z","title":"Spatial-Temporal Aware Visuomotor Diffusion Policy Learning","version":2},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-08-06T19:05:22.976915Z"},"links":{"citing_paper":"/paper/2507.06710"},"observation_digest":"sha256:d6e22a44a57b345f0562c764f7188b980fa87e126b4186e8070d234e39a27032","observation_id":"ad9e2ebd-e571-4991-9634-abbb852c07f6","resolution":{"observed_at":"2026-08-06T19:05:23.872840Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:05:23.834076Z","title":"Behavior transformers: Cloning k modes with one stone","venue":null,"work_id":"34712b50-b843-4a8a-a4ee-577fa769fd0b","year":2022},"citing_paper":{"arxiv_id":"2507.06710","last_updated":"2025-07-13T06:32:40Z","snapshot_observed_at":"2026-08-11T21:37:25.462224Z","submitted_at":"2025-07-09T10:08:15Z","title":"Spatial-Temporal Aware Visuomotor Diffusion Policy Learning","version":2},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-08-06T19:05:22.982250Z"},"links":{"citing_paper":"/paper/2507.06710"},"observation_digest":"sha256:f80aa2e83b3bf44e48046293fde8398410465734b160a20e231d7c967172506f","observation_id":"867a84fd-f060-4793-a9bb-9e6266729869","resolution":{"observed_at":"2026-08-06T19:05:23.844903Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2311.16098","last_updated":"2023-11-27T18:59:25Z","snapshot_observed_at":"2026-08-13T05:16:05.727138Z","submitted_at":"2023-11-27T18:59:25Z","title":"On Bringing Robots Home","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2311.16098","snapshot_observed_at":"2026-08-06T19:05:22.987266Z","title":"On bringing robots home","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2507.06710","last_updated":"2025-07-13T06:32:40Z","snapshot_observed_at":"2026-08-11T21:37:25.462224Z","submitted_at":"2025-07-09T10:08:15Z","title":"Spatial-Temporal Aware Visuomotor Diffusion Policy Learning","version":2},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-08-06T19:05:22.987266Z"},"links":{"cited_paper":"/paper/2311.16098","citing_paper":"/paper/2507.06710"},"observation_digest":"sha256:45b79ef8adbf575f6fdee8d2b8dedc58cf050a2f2c9db177fae25e2a5274c301","observation_id":"e864c6f7-987d-4d72-808c-cb8eac2069f8","resolution":{"observed_at":"2026-08-06T19:05:22.987266Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:05:22.992010Z","title":"Perceiver- actor: A multi-task transformer for robotic manipulation","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2507.06710","last_updated":"2025-07-13T06:32:40Z","snapshot_observed_at":"2026-08-11T21:37:25.462224Z","submitted_at":"2025-07-09T10:08:15Z","title":"Spatial-Temporal Aware Visuomotor Diffusion Policy Learning","version":2},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-08-06T19:05:22.992010Z"},"links":{"citing_paper":"/paper/2507.06710"},"observation_digest":"sha256:a2f38bd3ce0f41364ffbcfeb4d853a2ae833bcb1cfc26d1e5ded63fd2522a7c7","observation_id":"ee5206ba-4e57-4de2-92f5-3c3c709edf9e","resolution":{"observed_at":"2026-08-06T19:05:22.992010Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2010.02502","last_updated":"2022-10-05T20:19:21Z","snapshot_observed_at":"2026-08-11T15:38:14.931716Z","submitted_at":"2020-10-06T06:15:51Z","title":"Denoising Diffusion Implicit Models","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2010.02502","snapshot_observed_at":"2026-08-06T19:05:22.997333Z","title":"Denois- ing diffusion implicit models","venue":null,"work_id":null,"year":2010},"citing_paper":{"arxiv_id":"2507.06710","last_updated":"2025-07-13T06:32:40Z","snapshot_observed_at":"2026-08-11T21:37:25.462224Z","submitted_at":"2025-07-09T10:08:15Z","title":"Spatial-Temporal Aware Visuomotor Diffusion Policy Learning","version":2},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-08-06T19:05:22.997333Z"},"links":{"cited_paper":"/paper/2010.02502","citing_paper":"/paper/2507.06710"},"observation_digest":"sha256:9d11774ca311c21b9a102b72b2f6ebd891b7dde9db8b0bae5343a82aa315afa8","observation_id":"ba7cfe3d-5ff6-44d5-81a0-e3a79656c8ad","resolution":{"observed_at":"2026-08-06T19:05:22.997333Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:05:23.805741Z","title":"Vrl3: A data-driven framework for visual deep reinforce- ment learning","venue":null,"work_id":"db187345-4aac-4808-bb44-ad6dd7f81dd9","year":2022},"citing_paper":{"arxiv_id":"2507.06710","last_updated":"2025-07-13T06:32:40Z","snapshot_observed_at":"2026-08-11T21:37:25.462224Z","submitted_at":"2025-07-09T10:08:15Z","title":"Spatial-Temporal Aware Visuomotor Diffusion Policy Learning","version":2},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-08-06T19:05:23.002557Z"},"links":{"citing_paper":"/paper/2507.06710"},"observation_digest":"sha256:82b1dbc7862785c5296b257eef07c7e706058e771d77cefdda3f88395f5200dc","observation_id":"e39fbab2-58d2-4557-826e-87ed4c5b7767","resolution":{"observed_at":"2026-08-06T19:05:23.811926Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2302.12422","last_updated":"2023-10-13T05:44:37Z","snapshot_observed_at":"2026-08-13T12:38:21.086978Z","submitted_at":"2023-02-24T02:54:15Z","title":"MimicPlay: Long-Horizon Imitation Learning by Watching Human Play","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2302.12422","snapshot_observed_at":"2026-08-06T19:05:23.007925Z","title":"Mim- icplay: Long-horizon imitation learning by watching human play","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2507.06710","last_updated":"2025-07-13T06:32:40Z","snapshot_observed_at":"2026-08-11T21:37:25.462224Z","submitted_at":"2025-07-09T10:08:15Z","title":"Spatial-Temporal Aware Visuomotor Diffusion Policy Learning","version":2},"reference_index":36,"source":"pdf_text","source_observed_at":"2026-08-06T19:05:23.007925Z"},"links":{"cited_paper":"/paper/2302.12422","citing_paper":"/paper/2507.06710"},"observation_digest":"sha256:a97840cef056cd27c1a6a7dce6018ceb8d5afb44aa9a0764fb524a93031bbfed","observation_id":"cfbf36f3-7bc5-4e97-b8d8-77e92bee2224","resolution":{"observed_at":"2026-08-06T19:05:23.007925Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:05:23.013140Z","title":"Drivedreamer: Towards real-world- drive world models for autonomous driving","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2507.06710","last_updated":"2025-07-13T06:32:40Z","snapshot_observed_at":"2026-08-11T21:37:25.462224Z","submitted_at":"2025-07-09T10:08:15Z","title":"Spatial-Temporal Aware Visuomotor Diffusion Policy Learning","version":2},"reference_index":37,"source":"pdf_text","source_observed_at":"2026-08-06T19:05:23.013140Z"},"links":{"citing_paper":"/paper/2507.06710"},"observation_digest":"sha256:f9b10fff097a2cc5fd11985fd4b16f1740fe347d7febf2c8f59f600dba24151f","observation_id":"ccf48a71-b728-4331-bc86-0eb7bf636b32","resolution":{"observed_at":"2026-08-06T19:05:23.013140Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2208.06193","last_updated":"2023-08-25T19:39:32Z","snapshot_observed_at":"2026-08-12T13:12:28.417467Z","submitted_at":"2022-08-12T09:54:11Z","title":"Diffusion Policies as an Expressive Policy Class for Offline Reinforcement Learning","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2208.06193","snapshot_observed_at":"2026-08-06T19:05:23.018513Z","title":"Dif- fusion policies as an expressive policy class for offline rein- forcement learning","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2507.06710","last_updated":"2025-07-13T06:32:40Z","snapshot_observed_at":"2026-08-11T21:37:25.462224Z","submitted_at":"2025-07-09T10:08:15Z","title":"Spatial-Temporal Aware Visuomotor Diffusion Policy Learning","version":2},"reference_index":38,"source":"pdf_text","source_observed_at":"2026-08-06T19:05:23.018513Z"},"links":{"cited_paper":"/paper/2208.06193","citing_paper":"/paper/2507.06710"},"observation_digest":"sha256:3af66206525c2da6b0c509ab3b339397b4aee21c2ce97785aa167cadf02cf80f","observation_id":"302007d0-04f9-4809-a204-cca0d10cb5ed","resolution":{"observed_at":"2026-08-06T19:05:23.018513Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:05:23.024281Z","title":"4d gaussian splatting for real-time dynamic scene rendering","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.06710","last_updated":"2025-07-13T06:32:40Z","snapshot_observed_at":"2026-08-11T21:37:25.462224Z","submitted_at":"2025-07-09T10:08:15Z","title":"Spatial-Temporal Aware Visuomotor Diffusion Policy Learning","version":2},"reference_index":39,"source":"pdf_text","source_observed_at":"2026-08-06T19:05:23.024281Z"},"links":{"citing_paper":"/paper/2507.06710"},"observation_digest":"sha256:0734fd98bd3960fd285c6e35889427c07ae1cae5377a308618c5b17690afb216","observation_id":"aa7573ba-6072-45d8-aefe-383d5d535984","resolution":{"observed_at":"2026-08-06T19:05:23.024281Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:05:23.766503Z","title":"Daydreamer: World models for physical robot learning","venue":null,"work_id":"de20c9cf-3813-4cc9-9431-1ef733e6a0d0","year":2023},"citing_paper":{"arxiv_id":"2507.06710","last_updated":"2025-07-13T06:32:40Z","snapshot_observed_at":"2026-08-11T21:37:25.462224Z","submitted_at":"2025-07-09T10:08:15Z","title":"Spatial-Temporal Aware Visuomotor Diffusion Policy Learning","version":2},"reference_index":40,"source":"pdf_text","source_observed_at":"2026-08-06T19:05:23.029590Z"},"links":{"citing_paper":"/paper/2507.06710"},"observation_digest":"sha256:bf0263cdd4d49a85f1a952dc982aad815088aac538d30a9bb18bf6bec54323c2","observation_id":"e597020f-d902-4434-b0f1-3d55aacdf061","resolution":{"observed_at":"2026-08-06T19:05:23.771881Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2305.13122","last_updated":"2023-05-22T15:23:41Z","snapshot_observed_at":"2026-08-14T00:44:20.363356Z","submitted_at":"2023-05-22T15:23:41Z","title":"Policy Representation via Diffusion Probability Model for Reinforcement Learning","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2305.13122","snapshot_observed_at":"2026-08-06T19:05:23.036298Z","title":"Policy representation via diffusion prob- ability model for reinforcement learning","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2507.06710","last_updated":"2025-07-13T06:32:40Z","snapshot_observed_at":"2026-08-11T21:37:25.462224Z","submitted_at":"2025-07-09T10:08:15Z","title":"Spatial-Temporal Aware Visuomotor Diffusion Policy Learning","version":2},"reference_index":41,"source":"pdf_text","source_observed_at":"2026-08-06T19:05:23.036298Z"},"links":{"cited_paper":"/paper/2305.13122","citing_paper":"/paper/2507.06710"},"observation_digest":"sha256:55ffe8e6dc110cb9ee2941bf33712b2772ed2d639fc1420d8cf5e1ebde129754","observation_id":"514be2b5-fe6c-4f71-a7a9-a1595c06c978","resolution":{"observed_at":"2026-08-06T19:05:23.036298Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:05:23.751180Z","title":"Diffusion models: A comprehensive survey of methods and applications","venue":null,"work_id":"bc8380a1-cac3-4429-a582-0dbbd9eae3f2","year":2023},"citing_paper":{"arxiv_id":"2507.06710","last_updated":"2025-07-13T06:32:40Z","snapshot_observed_at":"2026-08-11T21:37:25.462224Z","submitted_at":"2025-07-09T10:08:15Z","title":"Spatial-Temporal Aware Visuomotor Diffusion Policy Learning","version":2},"reference_index":42,"source":"pdf_text","source_observed_at":"2026-08-06T19:05:23.042000Z"},"links":{"citing_paper":"/paper/2507.06710"},"observation_digest":"sha256:cbe5a205da57e8713a39acc9611cfd2bf2a636b2cc030a36f7c91d8e6141aeb1","observation_id":"46018c20-c352-4f65-83d2-ba5c8233baeb","resolution":{"observed_at":"2026-08-06T19:05:23.756437Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2310.01408","last_updated":"2025-05-04T22:44:25Z","snapshot_observed_at":"2026-08-13T05:59:05.166038Z","submitted_at":"2023-10-02T17:59:24Z","title":"Generalized Animal Imitator: Agile Locomotion with Versatile Motion Prior","version":3},"cited_work":{"arxiv_id":"2310.01408","doi":null,"metadata_source":"pith","pith_arxiv_id":"2310.01408","snapshot_observed_at":"2026-08-06T19:05:23.148817Z","title":"Generalized Animal Imitator: Agile Locomotion with Versatile Motion Prior","venue":"cs.RO","work_id":"7ff84b1c-0ef7-46d1-a785-5c316e44c81c","year":2023},"citing_paper":{"arxiv_id":"2507.06710","last_updated":"2025-07-13T06:32:40Z","snapshot_observed_at":"2026-08-11T21:37:25.462224Z","submitted_at":"2025-07-09T10:08:15Z","title":"Spatial-Temporal Aware Visuomotor Diffusion Policy Learning","version":2},"reference_index":43,"source":"pdf_text","source_observed_at":"2026-08-06T19:05:23.046703Z"},"links":{"cited_paper":"/paper/2310.01408","citing_paper":"/paper/2507.06710"},"observation_digest":"sha256:b8a02824f219062b94725864104e787314d19c8fda361f5c730a3a36da9764ab","observation_id":"2d024925-1e77-490e-a327-1eecff378921","resolution":{"observed_at":"2026-08-06T19:05:23.158552Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:05:23.734892Z","title":"Gnfactor: Multi-task real robot learning with generalizable neural feature fields","venue":null,"work_id":"79ff82d4-12dc-4f22-ae37-d0e4973cf944","year":2023},"citing_paper":{"arxiv_id":"2507.06710","last_updated":"2025-07-13T06:32:40Z","snapshot_observed_at":"2026-08-11T21:37:25.462224Z","submitted_at":"2025-07-09T10:08:15Z","title":"Spatial-Temporal Aware Visuomotor Diffusion Policy Learning","version":2},"reference_index":44,"source":"pdf_text","source_observed_at":"2026-08-06T19:05:23.053454Z"},"links":{"citing_paper":"/paper/2507.06710"},"observation_digest":"sha256:92eaf6f6d57033348c57f09afc2c5ece08ffad7d72344cb3a0d4bce10c011902","observation_id":"370597b8-28e3-4fab-ac61-76e8c103ecf5","resolution":{"observed_at":"2026-08-06T19:05:23.739593Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:05:23.713987Z","title":"3d diffusion policy: Gen- eralizable visuomotor policy learning via simple 3d repre- sentations","venue":null,"work_id":"052a4463-a974-4cc9-a499-e1259030799b","year":2024},"citing_paper":{"arxiv_id":"2507.06710","last_updated":"2025-07-13T06:32:40Z","snapshot_observed_at":"2026-08-11T21:37:25.462224Z","submitted_at":"2025-07-09T10:08:15Z","title":"Spatial-Temporal Aware Visuomotor Diffusion Policy Learning","version":2},"reference_index":45,"source":"pdf_text","source_observed_at":"2026-08-06T19:05:23.059200Z"},"links":{"citing_paper":"/paper/2507.06710"},"observation_digest":"sha256:8927152982ae07ea51cd845da964c5c511c80cb2087cb1ca1b739aab43968d16","observation_id":"2bddd8dc-1365-4e6e-ae5d-e6c97e526787","resolution":{"observed_at":"2026-08-06T19:05:23.719358Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:05:23.692099Z","title":"Point cloud matters: Rethinking the impact of different observation spaces on robot learn- ing","venue":null,"work_id":"102fece0-e570-4369-a8f5-b94a626d2ef9","year":2025},"citing_paper":{"arxiv_id":"2507.06710","last_updated":"2025-07-13T06:32:40Z","snapshot_observed_at":"2026-08-11T21:37:25.462224Z","submitted_at":"2025-07-09T10:08:15Z","title":"Spatial-Temporal Aware Visuomotor Diffusion Policy Learning","version":2},"reference_index":46,"source":"pdf_text","source_observed_at":"2026-08-06T19:05:23.066548Z"},"links":{"citing_paper":"/paper/2507.06710"},"observation_digest":"sha256:bad5141a5945ec119ba72b0f240415fab2d4af67fc205c95f74ce960528eb1b8","observation_id":"c3391e5d-44fb-42c5-a3b1-e76318eaa31f","resolution":{"observed_at":"2026-08-06T19:05:23.698332Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:05:23.662801Z","title":"Stacking Cups","venue":null,"work_id":"76194edc-16e9-45b9-b0e3-b6ed26bb8aa6","year":null},"citing_paper":{"arxiv_id":"2507.06710","last_updated":"2025-07-13T06:32:40Z","snapshot_observed_at":"2026-08-11T21:37:25.462224Z","submitted_at":"2025-07-09T10:08:15Z","title":"Spatial-Temporal Aware Visuomotor Diffusion Policy Learning","version":2},"reference_index":47,"source":"pdf_text","source_observed_at":"2026-08-06T19:05:23.073236Z"},"links":{"citing_paper":"/paper/2507.06710"},"observation_digest":"sha256:8e1df42ae467b1607e803addebdd7a1db68f9ec2c7ccaa9cdc2c2319e5a495c5","observation_id":"87825247-7f05-48cc-afff-51d4d6ae94fe","resolution":{"observed_at":"2026-08-06T19:05:23.670794Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:05:23.644926Z","title":"pointnet","venue":null,"work_id":"b3759eb9-61db-44ad-a5e9-43b71f281e03","year":null},"citing_paper":{"arxiv_id":"2507.06710","last_updated":"2025-07-13T06:32:40Z","snapshot_observed_at":"2026-08-11T21:37:25.462224Z","submitted_at":"2025-07-09T10:08:15Z","title":"Spatial-Temporal Aware Visuomotor Diffusion Policy Learning","version":2},"reference_index":48,"source":"pdf_text","source_observed_at":"2026-08-06T19:05:23.082730Z"},"links":{"citing_paper":"/paper/2507.06710"},"observation_digest":"sha256:a1881185214935a97f2f76f6624997f0272ef5d9c98a85f0ed3ed35d850860ad","observation_id":"2c829ac9-b042-45d9-9d6f-b9448988a646","resolution":{"observed_at":"2026-08-06T19:05:23.649837Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:05:23.626574Z","title":"Grasping Bottles","venue":null,"work_id":"30377f38-d0a7-49fd-ac49-60a9f6f58dc7","year":null},"citing_paper":{"arxiv_id":"2507.06710","last_updated":"2025-07-13T06:32:40Z","snapshot_observed_at":"2026-08-11T21:37:25.462224Z","submitted_at":"2025-07-09T10:08:15Z","title":"Spatial-Temporal Aware Visuomotor Diffusion Policy Learning","version":2},"reference_index":49,"source":"pdf_text","source_observed_at":"2026-08-06T19:05:23.090146Z"},"links":{"citing_paper":"/paper/2507.06710"},"observation_digest":"sha256:d22b3bfcb49f4f14b0c2ed76ac52e510545fb5c8451aca405f88891cbd21f9db","observation_id":"5a2ab06e-8bf9-49bb-8ef0-6beeb483b05b","resolution":{"observed_at":"2026-08-06T19:05:23.633047Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:05:23.610423Z","title":"grasping bottles","venue":null,"work_id":"004db442-457b-4a5d-8ac8-761be7f5b7a1","year":null},"citing_paper":{"arxiv_id":"2507.06710","last_updated":"2025-07-13T06:32:40Z","snapshot_observed_at":"2026-08-11T21:37:25.462224Z","submitted_at":"2025-07-09T10:08:15Z","title":"Spatial-Temporal Aware Visuomotor Diffusion Policy Learning","version":2},"reference_index":50,"source":"pdf_text","source_observed_at":"2026-08-06T19:05:23.096610Z"},"links":{"citing_paper":"/paper/2507.06710"},"observation_digest":"sha256:4eae0f1cfb7d3b9492d36bfe02ce3df400d969813db2e8e38d79c38820337bac","observation_id":"7d26c09c-48d4-468b-b9e0-5f1a41039ef9","resolution":{"observed_at":"2026-08-06T19:05:23.615125Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}}],"paper":{"arxiv_id":"2507.06710","last_updated":"2025-07-13T06:32:40Z","latest_version":2,"primary_category":"cs.RO","snapshot_observed_at":"2026-08-11T21:37:25.462224Z","submitted_at":"2025-07-09T10:08:15Z","title":"Spatial-Temporal Aware Visuomotor Diffusion Policy Learning"},"reference_resolution":{"displayed":50,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":22,"verified_exact":1,"verified_fuzzy":27},"total_outbound_references":50},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"thesis":"As of 14 August 2026, this Paper Citation Record lists 50 of 50 outbound references and 2 inbound Pith citation observations for arXiv:2507.06710."}