{"as_of":"2026-08-15T06:25:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:a7e900dcf0bd5ddc7d34eb67990aa5231fa17baeab2845d493f6acf61ccf794a","coverage":[{"denominator":69,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":69,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-05T13:46:46.313353Z","state":"measured"},{"denominator":74,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":74,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-14T06:32:32.682623+00:00","state":"measured"},{"denominator":5,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":5,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-02T09:18:02.907912Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"arxiv_reference","source_observed_at":"2026-07-03T20:38:55.094889Z","state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2509.00361","last_updated":"2025-08-30T04:53:32Z","snapshot_observed_at":"2026-08-14T20:37:46.603109Z","submitted_at":"2025-08-30T04:53:32Z","title":"Generative Visual Foresight Meets Task-Agnostic Pose Estimation in Robotic Table-Top Manipulation","version":1},"cited_work":{"arxiv_id":"2509.00361","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2509.00361","snapshot_observed_at":"2026-07-03T20:38:55.094889Z","title":"//arxiv.org/abs/2509.00361","venue":null,"work_id":"36cbd6be-b53f-4af1-8845-74c83e4bccb9","year":2025},"citing_paper":{"arxiv_id":"2604.04974","last_updated":"2026-06-03T17:05:28Z","snapshot_observed_at":"2026-08-05T03:49:14.637609Z","submitted_at":"2026-04-04T15:37:11Z","title":"From Video to Control: A Survey of Learning Manipulation Interfaces from Temporal Visual Data","version":1},"reference_index":108,"source":"arxiv_source","source_observed_at":"2026-05-13T17:02:18.358675Z"},"links":{"cited_paper":"/paper/2509.00361","citing_paper":"/paper/2604.04974"},"observation_digest":"sha256:0fd4d82bb0cea92546af7651c49dc3fd45e5294b25bc97108ea095b0077d653e","observation_id":"37a47e5d-9e6f-4853-b434-5c507f0f6260","resolution":{"observed_at":"2026-05-13T17:03:01.008057Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2509.00361","last_updated":"2025-08-30T04:53:32Z","snapshot_observed_at":"2026-08-14T20:37:46.603109Z","submitted_at":"2025-08-30T04:53:32Z","title":"Generative Visual Foresight Meets Task-Agnostic Pose Estimation in Robotic Table-Top Manipulation","version":1},"cited_work":{"arxiv_id":"2509.00361","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2509.00361","snapshot_observed_at":"2026-07-03T20:38:55.094889Z","title":"//arxiv.org/abs/2509.00361","venue":null,"work_id":"36cbd6be-b53f-4af1-8845-74c83e4bccb9","year":2025},"citing_paper":{"arxiv_id":"2607.00836","last_updated":"2026-08-12T06:05:26Z","snapshot_observed_at":"2026-08-15T06:09:30.213629Z","submitted_at":"2026-07-01T11:56:54Z","title":"From World Models to World Action Models: A Concise Tutorial for Robotics","version":1},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-07-02T11:26:48.626947Z"},"links":{"cited_paper":"/paper/2509.00361","citing_paper":"/paper/2607.00836"},"observation_digest":"sha256:d3bf1192e9f5c1db51200596b618bd6156aaa762251d738f79469c96552038db","observation_id":"91ce92ec-3a04-4158-8b5d-6a9173613662","resolution":{"observed_at":"2026-07-02T11:26:53.650928Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2509.00361","last_updated":"2025-08-30T04:53:32Z","snapshot_observed_at":"2026-08-14T20:37:46.603109Z","submitted_at":"2025-08-30T04:53:32Z","title":"Generative Visual Foresight Meets Task-Agnostic Pose Estimation in Robotic Table-Top Manipulation","version":1},"cited_work":{"arxiv_id":"2509.00361","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2509.00361","snapshot_observed_at":"2026-07-03T20:38:55.094889Z","title":"//arxiv.org/abs/2509.00361","venue":null,"work_id":"36cbd6be-b53f-4af1-8845-74c83e4bccb9","year":2025},"citing_paper":{"arxiv_id":"2607.00836","last_updated":"2026-08-12T06:05:26Z","snapshot_observed_at":"2026-08-15T06:09:30.213629Z","submitted_at":"2026-07-01T11:56:54Z","title":"From World Models to World Action Models: A Concise Tutorial for Robotics","version":2},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-07-03T20:35:21.512564Z"},"links":{"cited_paper":"/paper/2509.00361","citing_paper":"/paper/2607.00836"},"observation_digest":"sha256:e43f0e8183e943c17ee72bf5718626762876fc5bcb22ef500004d74b9f8cea6e","observation_id":"dc092ea0-6538-47b3-a14e-72d972c2dc29","resolution":{"observed_at":"2026-07-03T20:38:55.096306Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2509.00361","last_updated":"2025-08-30T04:53:32Z","snapshot_observed_at":"2026-08-14T20:37:46.603109Z","submitted_at":"2025-08-30T04:53:32Z","title":"Generative Visual Foresight Meets Task-Agnostic Pose Estimation in Robotic Table-Top Manipulation","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2509.00361","snapshot_observed_at":"2026-07-12T09:15:00.615740Z","title":"Zhen, H., Sun, Q., Zhang, H., Li, J., Zhou, S., Du, Y ., and Gan, C","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.00836","last_updated":"2026-08-12T06:05:26Z","snapshot_observed_at":"2026-08-15T06:09:30.213629Z","submitted_at":"2026-07-01T11:56:54Z","title":"From World Models to World Action Models: A Concise Tutorial for Robotics","version":3},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-07-12T09:15:00.615740Z"},"links":{"cited_paper":"/paper/2509.00361","citing_paper":"/paper/2607.00836"},"observation_digest":"sha256:a981b19ffb221b6cb965a0279c2be2f6d8db47084bffc61c6804b25e5dcbc3a4","observation_id":"d2a87dfa-fb0d-4396-8215-678890cb02d3","resolution":{"observed_at":"2026-07-12T09:15:00.615740Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2509.00361","last_updated":"2025-08-30T04:53:32Z","snapshot_observed_at":"2026-08-14T20:37:46.603109Z","submitted_at":"2025-08-30T04:53:32Z","title":"Generative Visual Foresight Meets Task-Agnostic Pose Estimation in Robotic Table-Top Manipulation","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2509.00361","snapshot_observed_at":"2026-08-02T09:18:02.907912Z","title":"Zhen, H., Sun, Q., Zhang, H., Li, J., Zhou, S., Du, Y ., and Gan, C","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.00836","last_updated":"2026-08-12T06:05:26Z","snapshot_observed_at":"2026-08-15T06:09:30.213629Z","submitted_at":"2026-07-01T11:56:54Z","title":"From World Models to World Action Models: A Concise Tutorial for Robotics","version":4},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-08-02T09:18:02.907912Z"},"links":{"cited_paper":"/paper/2509.00361","citing_paper":"/paper/2607.00836"},"observation_digest":"sha256:0b010edb71576f54ed3cade97d4c29050e37524920881e0f97f639b3be029b36","observation_id":"c113a405-02c9-49df-ab82-fdf76331c0a8","resolution":{"observed_at":"2026-08-02T09:18:02.907912Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"links":{"evidence":"/evidence","html":"/paper/2509.00361/citation-record","integrity":"/paper/2509.00361/integrity","json":"/paper/2509.00361/citation-record.json","paper":"/paper/2509.00361"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":"10.1038/s44271-024-00153-x","metadata_source":"openalex","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T05:30:23.456663Z","title":"Pilacinski, A","venue":"Communications Psychology","work_id":"f28127cb-4e3d-455c-9d05-263705b2f6c9","year":2024},"citing_paper":{"arxiv_id":"2509.00361","last_updated":"2025-08-30T04:53:32Z","snapshot_observed_at":"2026-08-14T20:37:46.603109Z","submitted_at":"2025-08-30T04:53:32Z","title":"Generative Visual Foresight Meets Task-Agnostic Pose Estimation in Robotic Table-Top Manipulation","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-05T13:46:40.587378Z"},"links":{"citing_paper":"/paper/2509.00361"},"observation_digest":"sha256:57687b7d88392f6995f8a22a69828ec0270231a995db0853b7fc3fd63043d5e0","observation_id":"44f85150-9ece-4105-bbd0-fe68104d0671","resolution":{"observed_at":"2026-08-05T13:46:47.004440Z","resolver_source":"doi","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":"10.1177/0956797613497968","metadata_source":"openalex","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T05:30:23.456663Z","title":null,"venue":"Psychological Science","work_id":"1a1fac5e-34ed-44ea-9ace-5f9ec04d3b22","year":2014},"citing_paper":{"arxiv_id":"2509.00361","last_updated":"2025-08-30T04:53:32Z","snapshot_observed_at":"2026-08-14T20:37:46.603109Z","submitted_at":"2025-08-30T04:53:32Z","title":"Generative Visual Foresight Meets Task-Agnostic Pose Estimation in Robotic Table-Top Manipulation","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-05T13:46:40.675463Z"},"links":{"citing_paper":"/paper/2509.00361"},"observation_digest":"sha256:542a18ade5cbd1eef8b529cfa2c1ee237c4b36daa1c34ebaa4508ee8e316377c","observation_id":"3f0c72b0-6b6d-41d9-899e-62e929e3b4cb","resolution":{"observed_at":"2026-08-05T13:46:46.704949Z","resolver_source":"doi","status":"verified_exact"},"standing_notice":{"events":[{"edge_observation":{"observed_at":"2026-08-05T18:20:27.254155+00:00","source":"paper_reference_links","state":"open"},"event_date":"2014-01-28","event_type":"correction","notice_doi":"10.1177/0956797613520537","provenance":{"observed_at":"2026-07-11T03:02:22.628099+00:00","source":"crossref","source_record_id":"10.1177/0956797613520537->10.1177/0956797613497968:correction"}}],"reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":"10.1097/wco.0000000000000160","metadata_source":"openalex","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T05:30:23.456663Z","title":"Faivre, R","venue":"Current Opinion in Neurology","work_id":"b82ca5f9-32d7-4679-95ed-38ec18326a36","year":2015},"citing_paper":{"arxiv_id":"2509.00361","last_updated":"2025-08-30T04:53:32Z","snapshot_observed_at":"2026-08-14T20:37:46.603109Z","submitted_at":"2025-08-30T04:53:32Z","title":"Generative Visual Foresight Meets Task-Agnostic Pose Estimation in Robotic Table-Top Manipulation","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-05T13:46:40.716204Z"},"links":{"citing_paper":"/paper/2509.00361"},"observation_digest":"sha256:94bd27375d6a893ed25230eaad586be07e229d791e302c41c03a8e3e2cdf5658","observation_id":"021175f1-6c5f-49e5-b084-53f7073574cf","resolution":{"observed_at":"2026-08-05T13:46:46.519013Z","resolver_source":"doi","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T13:46:53.148851Z","title":"Yokosaka, S","venue":null,"work_id":"47c3d127-af5a-4165-9121-fef97f7268b5","year":2015},"citing_paper":{"arxiv_id":"2509.00361","last_updated":"2025-08-30T04:53:32Z","snapshot_observed_at":"2026-08-14T20:37:46.603109Z","submitted_at":"2025-08-30T04:53:32Z","title":"Generative Visual Foresight Meets Task-Agnostic Pose Estimation in Robotic Table-Top Manipulation","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-05T13:46:40.774818Z"},"links":{"citing_paper":"/paper/2509.00361"},"observation_digest":"sha256:c6c28e6971ba3bd43ea3dd84a37b67d67b40eb91dc8dfc399ec36dcda8490af5","observation_id":"c72a4797-ab7f-454a-86e7-9bb7b9827eab","resolution":{"observed_at":"2026-08-05T13:46:53.162583Z","resolver_source":"raw_fallback","status":"malformed_identifier"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2406.09246","last_updated":"2024-09-05T19:46:34Z","snapshot_observed_at":"2026-08-15T04:55:15.159462Z","submitted_at":"2024-06-13T15:46:55Z","title":"OpenVLA: An Open-Source Vision-Language-Action Model","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2406.09246","snapshot_observed_at":"2026-08-05T13:46:40.831539Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2509.00361","last_updated":"2025-08-30T04:53:32Z","snapshot_observed_at":"2026-08-14T20:37:46.603109Z","submitted_at":"2025-08-30T04:53:32Z","title":"Generative Visual Foresight Meets Task-Agnostic Pose Estimation in Robotic Table-Top Manipulation","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-05T13:46:40.831539Z"},"links":{"cited_paper":"/paper/2406.09246","citing_paper":"/paper/2509.00361"},"observation_digest":"sha256:e04a0676b46b95fab0235bddd7bc4c0223547710646c5c3a90990e1a9709bd17","observation_id":"da4e8ebc-cbf2-489b-a368-29d1c68da847","resolution":{"observed_at":"2026-08-05T13:46:40.831539Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T13:46:40.943971Z","title":"Ghosh, H","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2509.00361","last_updated":"2025-08-30T04:53:32Z","snapshot_observed_at":"2026-08-14T20:37:46.603109Z","submitted_at":"2025-08-30T04:53:32Z","title":"Generative Visual Foresight Meets Task-Agnostic Pose Estimation in Robotic Table-Top Manipulation","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-05T13:46:40.943971Z"},"links":{"citing_paper":"/paper/2509.00361"},"observation_digest":"sha256:f5444d592a06305f8ea9fefcd5d98e71b9ea51b5564a029a32aa11007bafb3ca","observation_id":"1ae7a7ad-7b2a-4f4c-aee4-f847aee2a2cf","resolution":{"observed_at":"2026-08-05T13:46:40.943971Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2212.06817","last_updated":"2023-08-11T17:45:27Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2022-12-13T18:55:15Z","title":"RT-1: Robotics Transformer for Real-World Control at Scale","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2212.06817","snapshot_observed_at":"2026-08-05T13:46:41.025653Z","title":"Brohan, N","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2509.00361","last_updated":"2025-08-30T04:53:32Z","snapshot_observed_at":"2026-08-14T20:37:46.603109Z","submitted_at":"2025-08-30T04:53:32Z","title":"Generative Visual Foresight Meets Task-Agnostic Pose Estimation in Robotic Table-Top Manipulation","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-05T13:46:41.025653Z"},"links":{"cited_paper":"/paper/2212.06817","citing_paper":"/paper/2509.00361"},"observation_digest":"sha256:dbaa2bfa3103c70b3d83799e904eda761f4017201988c754ace51e69fa0b925f","observation_id":"1a4c6b88-bf8c-40a4-b512-c43c8d1d6b05","resolution":{"observed_at":"2026-08-05T13:46:41.025653Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2307.15818","last_updated":"2023-07-28T21:18:02Z","snapshot_observed_at":"2026-08-02T16:17:50.621617Z","submitted_at":"2023-07-28T21:18:02Z","title":"RT-2: Vision-Language-Action Models Transfer Web Knowledge to Robotic Control","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2307.15818","snapshot_observed_at":"2026-08-05T13:46:41.128379Z","title":"Brohan, N","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2509.00361","last_updated":"2025-08-30T04:53:32Z","snapshot_observed_at":"2026-08-14T20:37:46.603109Z","submitted_at":"2025-08-30T04:53:32Z","title":"Generative Visual Foresight Meets Task-Agnostic Pose Estimation in Robotic Table-Top Manipulation","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-05T13:46:41.128379Z"},"links":{"cited_paper":"/paper/2307.15818","citing_paper":"/paper/2509.00361"},"observation_digest":"sha256:b973998d59fbdda08479abe64ad3f7056925183e1c4f5cb4151d20346ab4c689","observation_id":"040e83ec-8af6-406c-a80b-6b80fd64f26c","resolution":{"observed_at":"2026-08-05T13:46:41.128379Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2410.24164","last_updated":"2026-01-08T17:01:05Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-10-31T17:22:30Z","title":"$\\pi_0$: A Vision-Language-Action Flow Model for General Robot Control","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2410.24164","snapshot_observed_at":"2026-08-05T13:46:41.215161Z","title":"Black, N","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2509.00361","last_updated":"2025-08-30T04:53:32Z","snapshot_observed_at":"2026-08-14T20:37:46.603109Z","submitted_at":"2025-08-30T04:53:32Z","title":"Generative Visual Foresight Meets Task-Agnostic Pose Estimation in Robotic Table-Top Manipulation","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-05T13:46:41.215161Z"},"links":{"cited_paper":"/paper/2410.24164","citing_paper":"/paper/2509.00361"},"observation_digest":"sha256:9475280464dc1cf8edec55f2fbd5f05593552eec4c6f9ffea819d4966822dff5","observation_id":"1fc43ed9-d9e4-4b61-be7c-5d1c4d81762b","resolution":{"observed_at":"2026-08-05T13:46:41.215161Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2203.12601","last_updated":"2022-11-18T05:57:09Z","snapshot_observed_at":"2026-08-11T08:36:53.636356Z","submitted_at":"2022-03-23T17:55:09Z","title":"R3M: A Universal Visual Representation for Robot Manipulation","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2203.12601","snapshot_observed_at":"2026-08-05T13:46:41.282467Z","title":null,"venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2509.00361","last_updated":"2025-08-30T04:53:32Z","snapshot_observed_at":"2026-08-14T20:37:46.603109Z","submitted_at":"2025-08-30T04:53:32Z","title":"Generative Visual Foresight Meets Task-Agnostic Pose Estimation in Robotic Table-Top Manipulation","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-05T13:46:41.282467Z"},"links":{"cited_paper":"/paper/2203.12601","citing_paper":"/paper/2509.00361"},"observation_digest":"sha256:8586a0a98a0b10405de2ff93d40e88fb4fdee78710756453da71e89b277edc43","observation_id":"1f9721e8-1adc-4e06-8553-8efed08bd421","resolution":{"observed_at":"2026-08-05T13:46:41.282467Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2410.22325","last_updated":"2024-10-30T03:33:08Z","snapshot_observed_at":"2026-08-12T22:12:30.614626Z","submitted_at":"2024-10-29T17:58:13Z","title":"Robots Pre-train Robots: Manipulation-Centric Robotic Representation from Large-Scale Robot Datasets","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2410.22325","snapshot_observed_at":"2026-08-05T13:46:41.329672Z","title":"Jiang, Y","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2509.00361","last_updated":"2025-08-30T04:53:32Z","snapshot_observed_at":"2026-08-14T20:37:46.603109Z","submitted_at":"2025-08-30T04:53:32Z","title":"Generative Visual Foresight Meets Task-Agnostic Pose Estimation in Robotic Table-Top Manipulation","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-05T13:46:41.329672Z"},"links":{"cited_paper":"/paper/2410.22325","citing_paper":"/paper/2509.00361"},"observation_digest":"sha256:91a1acaefe28a1031014282be8c48f5ad3b3745a675d875d8dbe675fb2d6be4a","observation_id":"83b2689b-57c4-43af-a915-33773a2848f5","resolution":{"observed_at":"2026-08-05T13:46:41.329672Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2410.11758","last_updated":"2025-05-15T12:13:37Z","snapshot_observed_at":"2026-08-12T08:06:42.236760Z","submitted_at":"2024-10-15T16:28:09Z","title":"Latent Action Pretraining from Videos","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2410.11758","snapshot_observed_at":"2026-08-05T13:46:41.391260Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2509.00361","last_updated":"2025-08-30T04:53:32Z","snapshot_observed_at":"2026-08-14T20:37:46.603109Z","submitted_at":"2025-08-30T04:53:32Z","title":"Generative Visual Foresight Meets Task-Agnostic Pose Estimation in Robotic Table-Top Manipulation","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-05T13:46:41.391260Z"},"links":{"cited_paper":"/paper/2410.11758","citing_paper":"/paper/2509.00361"},"observation_digest":"sha256:21ae58b7a2c4a2aee593ab37312bc978a06618fa6de51f0e57bea7072a9aad84","observation_id":"ebcfce30-e81e-449d-a0f6-1bf1ddd6b4d4","resolution":{"observed_at":"2026-08-05T13:46:41.391260Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2310.10639","last_updated":"2023-10-16T17:57:23Z","snapshot_observed_at":"2026-08-08T13:35:58.479807Z","submitted_at":"2023-10-16T17:57:23Z","title":"Zero-Shot Robotic Manipulation with Pretrained Image-Editing Diffusion Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2310.10639","snapshot_observed_at":"2026-08-05T13:46:41.485175Z","title":"Black, M","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2509.00361","last_updated":"2025-08-30T04:53:32Z","snapshot_observed_at":"2026-08-14T20:37:46.603109Z","submitted_at":"2025-08-30T04:53:32Z","title":"Generative Visual Foresight Meets Task-Agnostic Pose Estimation in Robotic Table-Top Manipulation","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-05T13:46:41.485175Z"},"links":{"cited_paper":"/paper/2310.10639","citing_paper":"/paper/2509.00361"},"observation_digest":"sha256:2c6dd3cc57e0ce714fb3f35264fe60831c8db06cc1c3b11a3108e82e03569085","observation_id":"7a53ce2d-b9be-45b5-96ad-327cac5362a9","resolution":{"observed_at":"2026-08-05T13:46:41.485175Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T13:46:53.092049Z","title":null,"venue":null,"work_id":"b6ca0a5f-753f-4936-8359-a9d9305fa001","year":2023},"citing_paper":{"arxiv_id":"2509.00361","last_updated":"2025-08-30T04:53:32Z","snapshot_observed_at":"2026-08-14T20:37:46.603109Z","submitted_at":"2025-08-30T04:53:32Z","title":"Generative Visual Foresight Meets Task-Agnostic Pose Estimation in Robotic Table-Top Manipulation","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-05T13:46:41.544067Z"},"links":{"citing_paper":"/paper/2509.00361"},"observation_digest":"sha256:898342b14436b69f78d38891a22a94332bccd10d0ad37bd9ea735def9155dc7a","observation_id":"60703a6e-3893-4d0c-87e6-4b9839dca071","resolution":{"observed_at":"2026-08-05T13:46:53.101626Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2409.09016","last_updated":"2024-10-16T08:38:07Z","snapshot_observed_at":"2026-08-14T11:45:37.708677Z","submitted_at":"2024-09-13T17:45:07Z","title":"Closed-Loop Visuomotor Control with Generative Expectation for Robotic Manipulation","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2409.09016","snapshot_observed_at":"2026-08-05T13:46:41.645910Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2509.00361","last_updated":"2025-08-30T04:53:32Z","snapshot_observed_at":"2026-08-14T20:37:46.603109Z","submitted_at":"2025-08-30T04:53:32Z","title":"Generative Visual Foresight Meets Task-Agnostic Pose Estimation in Robotic Table-Top Manipulation","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-05T13:46:41.645910Z"},"links":{"cited_paper":"/paper/2409.09016","citing_paper":"/paper/2509.00361"},"observation_digest":"sha256:ac1a5ae21491dc6ca4cc1840d91dba84c2e597ba2afb89406cfba03b1a0c8d44","observation_id":"3f787edb-d74e-4f69-bcf9-445b7a860f6d","resolution":{"observed_at":"2026-08-05T13:46:41.645910Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2401.00025","last_updated":"2024-07-12T12:51:00Z","snapshot_observed_at":"2026-07-06T17:09:59.848387Z","submitted_at":"2023-12-28T23:34:43Z","title":"Any-point Trajectory Modeling for Policy Learning","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2401.00025","snapshot_observed_at":"2026-08-05T13:46:41.715080Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2509.00361","last_updated":"2025-08-30T04:53:32Z","snapshot_observed_at":"2026-08-14T20:37:46.603109Z","submitted_at":"2025-08-30T04:53:32Z","title":"Generative Visual Foresight Meets Task-Agnostic Pose Estimation in Robotic Table-Top Manipulation","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-05T13:46:41.715080Z"},"links":{"cited_paper":"/paper/2401.00025","citing_paper":"/paper/2509.00361"},"observation_digest":"sha256:fe50f616cc1c83e538c9a384bab4c832ec2c7e4c660b25c7d5b2832bc55e980b","observation_id":"a9114b8e-feb4-4d12-8dc2-270d94feba53","resolution":{"observed_at":"2026-08-05T13:46:41.715080Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2407.15208","last_updated":"2024-10-04T04:05:27Z","snapshot_observed_at":"2026-08-12T23:17:46.935553Z","submitted_at":"2024-07-21T16:15:02Z","title":"Flow as the Cross-Domain Manipulation Interface","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2407.15208","snapshot_observed_at":"2026-08-05T13:46:41.800733Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2509.00361","last_updated":"2025-08-30T04:53:32Z","snapshot_observed_at":"2026-08-14T20:37:46.603109Z","submitted_at":"2025-08-30T04:53:32Z","title":"Generative Visual Foresight Meets Task-Agnostic Pose Estimation in Robotic Table-Top Manipulation","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-05T13:46:41.800733Z"},"links":{"cited_paper":"/paper/2407.15208","citing_paper":"/paper/2509.00361"},"observation_digest":"sha256:fae3083976462d6359f50c0ab78cc6dd038fbf2b96078e78734ba3252582126e","observation_id":"fed99a58-86c5-4f89-97eb-930c96553666","resolution":{"observed_at":"2026-08-05T13:46:41.800733Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2310.08576","last_updated":"2023-10-12T17:59:23Z","snapshot_observed_at":"2026-08-14T23:00:27.517515Z","submitted_at":"2023-10-12T17:59:23Z","title":"Learning to Act from Actionless Videos through Dense Correspondences","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2310.08576","snapshot_observed_at":"2026-08-05T13:46:41.955554Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2509.00361","last_updated":"2025-08-30T04:53:32Z","snapshot_observed_at":"2026-08-14T20:37:46.603109Z","submitted_at":"2025-08-30T04:53:32Z","title":"Generative Visual Foresight Meets Task-Agnostic Pose Estimation in Robotic Table-Top Manipulation","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-05T13:46:41.955554Z"},"links":{"cited_paper":"/paper/2310.08576","citing_paper":"/paper/2509.00361"},"observation_digest":"sha256:fea9c96ff40a7307b2a1056cbb4f0a6fb48d72a7a906b0ed788a1f3d713f076d","observation_id":"5de35d0b-5b26-46dd-a4a7-6f8f71c7f439","resolution":{"observed_at":"2026-08-05T13:46:41.955554Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T13:46:53.057047Z","title":"Luo and Y","venue":null,"work_id":"8cadd194-e893-49e0-9a3d-22ceb10d7059","year":null},"citing_paper":{"arxiv_id":"2509.00361","last_updated":"2025-08-30T04:53:32Z","snapshot_observed_at":"2026-08-14T20:37:46.603109Z","submitted_at":"2025-08-30T04:53:32Z","title":"Generative Visual Foresight Meets Task-Agnostic Pose Estimation in Robotic Table-Top Manipulation","version":1},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-05T13:46:42.045016Z"},"links":{"citing_paper":"/paper/2509.00361"},"observation_digest":"sha256:e867fc4cbdba8b57e7f2d7600f1e39404ff8844143b482fff7bf4f63fc0be9ac","observation_id":"2a6ed33d-b7c8-4712-ad44-080d99ede465","resolution":{"observed_at":"2026-08-05T13:46:53.067121Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2406.16862","last_updated":"2024-06-24T17:59:45Z","snapshot_observed_at":"2026-08-12T23:35:51.734823Z","submitted_at":"2024-06-24T17:59:45Z","title":"Dreamitate: Real-World Visuomotor Policy Learning via Video Generation","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2406.16862","snapshot_observed_at":"2026-08-05T13:46:42.190907Z","title":"Liang, R","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2509.00361","last_updated":"2025-08-30T04:53:32Z","snapshot_observed_at":"2026-08-14T20:37:46.603109Z","submitted_at":"2025-08-30T04:53:32Z","title":"Generative Visual Foresight Meets Task-Agnostic Pose Estimation in Robotic Table-Top Manipulation","version":1},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-05T13:46:42.190907Z"},"links":{"cited_paper":"/paper/2406.16862","citing_paper":"/paper/2509.00361"},"observation_digest":"sha256:970d3ab95c53f5d278b14be22f755e447e3a75960e1e57b823afa22e3c64bca5","observation_id":"ec15c64e-e179-40d1-842e-775872f48e36","resolution":{"observed_at":"2026-08-05T13:46:42.190907Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2407.07875","last_updated":"2024-10-08T17:43:06Z","snapshot_observed_at":"2026-08-15T02:42:48.622060Z","submitted_at":"2024-07-10T17:41:10Z","title":"Generative Image as Action Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2407.07875","snapshot_observed_at":"2026-08-05T13:46:42.288905Z","title":"Shridhar, Y","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2509.00361","last_updated":"2025-08-30T04:53:32Z","snapshot_observed_at":"2026-08-14T20:37:46.603109Z","submitted_at":"2025-08-30T04:53:32Z","title":"Generative Visual Foresight Meets Task-Agnostic Pose Estimation in Robotic Table-Top Manipulation","version":1},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-05T13:46:42.288905Z"},"links":{"cited_paper":"/paper/2407.07875","citing_paper":"/paper/2509.00361"},"observation_digest":"sha256:dfb10fa714ea78a381efe560035e919b5f0c7b6b08f102889a9928f1e1a5fa1a","observation_id":"8072a741-9bb4-46c7-8fdf-617405354e20","resolution":{"observed_at":"2026-08-05T13:46:42.288905Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2412.15109","last_updated":"2024-12-19T17:52:50Z","snapshot_observed_at":"2026-07-06T20:10:19.704368Z","submitted_at":"2024-12-19T17:52:50Z","title":"Predictive Inverse Dynamics Models are Scalable Learners for Robotic Manipulation","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2412.15109","snapshot_observed_at":"2026-08-05T13:46:42.380714Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2509.00361","last_updated":"2025-08-30T04:53:32Z","snapshot_observed_at":"2026-08-14T20:37:46.603109Z","submitted_at":"2025-08-30T04:53:32Z","title":"Generative Visual Foresight Meets Task-Agnostic Pose Estimation in Robotic Table-Top Manipulation","version":1},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-05T13:46:42.380714Z"},"links":{"cited_paper":"/paper/2412.15109","citing_paper":"/paper/2509.00361"},"observation_digest":"sha256:4bd36302942eaf3f6c38fc17d396ebd96c78dc1203bc64d72adf0d137eae0158","observation_id":"629ff88f-05d0-40eb-9eb9-812fc9976e70","resolution":{"observed_at":"2026-08-05T13:46:42.380714Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2410.06158","last_updated":"2024-10-08T16:00:47Z","snapshot_observed_at":"2026-08-12T23:18:51.506083Z","submitted_at":"2024-10-08T16:00:47Z","title":"GR-2: A Generative Video-Language-Action Model with Web-Scale Knowledge for Robot Manipulation","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2410.06158","snapshot_observed_at":"2026-08-05T13:46:42.481513Z","title":"Cheang, G","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2509.00361","last_updated":"2025-08-30T04:53:32Z","snapshot_observed_at":"2026-08-14T20:37:46.603109Z","submitted_at":"2025-08-30T04:53:32Z","title":"Generative Visual Foresight Meets Task-Agnostic Pose Estimation in Robotic Table-Top Manipulation","version":1},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-05T13:46:42.481513Z"},"links":{"cited_paper":"/paper/2410.06158","citing_paper":"/paper/2509.00361"},"observation_digest":"sha256:cd6fc22ad6af3bae2aa588dc1072e41df5b2ae686441894fa50132580bc62ddd","observation_id":"b69a492f-c3ad-4efd-8d90-333674e1472f","resolution":{"observed_at":"2026-08-05T13:46:42.481513Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2312.13139","last_updated":"2023-12-21T05:34:23Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2023-12-20T16:00:43Z","title":"Unleashing Large-Scale Video Generative Pre-training for Visual Robot Manipulation","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2312.13139","snapshot_observed_at":"2026-08-05T13:46:42.565886Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2509.00361","last_updated":"2025-08-30T04:53:32Z","snapshot_observed_at":"2026-08-14T20:37:46.603109Z","submitted_at":"2025-08-30T04:53:32Z","title":"Generative Visual Foresight Meets Task-Agnostic Pose Estimation in Robotic Table-Top Manipulation","version":1},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-08-05T13:46:42.565886Z"},"links":{"cited_paper":"/paper/2312.13139","citing_paper":"/paper/2509.00361"},"observation_digest":"sha256:5d2044d7dce8d6bef2119ba3a541a7737992a07db46071271e2c3f3feb793b04","observation_id":"d8b5e56c-f63d-4e68-b95d-32e5da9ad8e1","resolution":{"observed_at":"2026-08-05T13:46:42.565886Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T13:46:53.028679Z","title":"Merrill, Y","venue":null,"work_id":"6b1e4606-0089-47aa-a832-3b1655a66c1c","year":2022},"citing_paper":{"arxiv_id":"2509.00361","last_updated":"2025-08-30T04:53:32Z","snapshot_observed_at":"2026-08-14T20:37:46.603109Z","submitted_at":"2025-08-30T04:53:32Z","title":"Generative Visual Foresight Meets Task-Agnostic Pose Estimation in Robotic Table-Top Manipulation","version":1},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-08-05T13:46:42.648312Z"},"links":{"citing_paper":"/paper/2509.00361"},"observation_digest":"sha256:8b9808a117ae6ae024317379e65ec8ad2f823cb861ac1ccaf9a1bdd85021272f","observation_id":"d37cedc2-5fa8-49cd-83f3-79cac17edd63","resolution":{"observed_at":"2026-08-05T13:46:53.036358Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T13:46:52.990056Z","title":"Rad and V","venue":null,"work_id":"cf6b3e82-b366-4444-8c53-dfec4fea0549","year":2017},"citing_paper":{"arxiv_id":"2509.00361","last_updated":"2025-08-30T04:53:32Z","snapshot_observed_at":"2026-08-14T20:37:46.603109Z","submitted_at":"2025-08-30T04:53:32Z","title":"Generative Visual Foresight Meets Task-Agnostic Pose Estimation in Robotic Table-Top Manipulation","version":1},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-08-05T13:46:42.702926Z"},"links":{"citing_paper":"/paper/2509.00361"},"observation_digest":"sha256:069bed785123dc3a5f6b6de23f3c4e1e932301827cbc7d8459ce7ad69844241c","observation_id":"b089404d-bf89-4df3-83a1-25efea150187","resolution":{"observed_at":"2026-08-05T13:46:53.003283Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T13:46:52.965136Z","title":null,"venue":null,"work_id":"ba52f9cd-4029-4164-8c9e-c810d3978c33","year":2020},"citing_paper":{"arxiv_id":"2509.00361","last_updated":"2025-08-30T04:53:32Z","snapshot_observed_at":"2026-08-14T20:37:46.603109Z","submitted_at":"2025-08-30T04:53:32Z","title":"Generative Visual Foresight Meets Task-Agnostic Pose Estimation in Robotic Table-Top Manipulation","version":1},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-08-05T13:46:42.794961Z"},"links":{"citing_paper":"/paper/2509.00361"},"observation_digest":"sha256:1fc151590a44ff772ac64ae9de131264e8f53425f04ea4c7c960d76857bc0a1e","observation_id":"f2d07038-3a4a-4d64-aea9-b56abe5e1d81","resolution":{"observed_at":"2026-08-05T13:46:52.972115Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T13:46:52.933609Z","title":null,"venue":null,"work_id":"54e017f1-a638-472f-a458-7ef9740c33bc","year":2020},"citing_paper":{"arxiv_id":"2509.00361","last_updated":"2025-08-30T04:53:32Z","snapshot_observed_at":"2026-08-14T20:37:46.603109Z","submitted_at":"2025-08-30T04:53:32Z","title":"Generative Visual Foresight Meets Task-Agnostic Pose Estimation in Robotic Table-Top Manipulation","version":1},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-08-05T13:46:42.883191Z"},"links":{"citing_paper":"/paper/2509.00361"},"observation_digest":"sha256:9b34d708232a5d6c4093375ad568be830370a93f8d2423e5311952b2bd958e1f","observation_id":"a8156329-0910-402e-b78e-9388662acc65","resolution":{"observed_at":"2026-08-05T13:46:52.941192Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1809.10790","last_updated":"2018-09-27T22:45:53Z","snapshot_observed_at":"2026-08-14T18:22:27.854030Z","submitted_at":"2018-09-27T22:45:53Z","title":"Deep Object Pose Estimation for Semantic Robotic Grasping of Household Objects","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1809.10790","snapshot_observed_at":"2026-08-05T13:46:42.950287Z","title":"Tremblay, T","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2509.00361","last_updated":"2025-08-30T04:53:32Z","snapshot_observed_at":"2026-08-14T20:37:46.603109Z","submitted_at":"2025-08-30T04:53:32Z","title":"Generative Visual Foresight Meets Task-Agnostic Pose Estimation in Robotic Table-Top Manipulation","version":1},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-08-05T13:46:42.950287Z"},"links":{"cited_paper":"/paper/1809.10790","citing_paper":"/paper/2509.00361"},"observation_digest":"sha256:a18ac016465026548eefb26a6f01edf76f6198bd736dd513fbfa46232039d29a","observation_id":"7f695c63-31f5-40d3-aec6-e90e4780b4f7","resolution":{"observed_at":"2026-08-05T13:46:42.950287Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2203.09418","last_updated":"2022-03-29T18:23:03Z","snapshot_observed_at":"2026-08-14T02:13:32.534857Z","submitted_at":"2022-03-17T16:16:24Z","title":"ZebraPose: Coarse to Fine Surface Encoding for 6DoF Object Pose Estimation","version":2},"cited_work":{"arxiv_id":"2203.09418","doi":null,"metadata_source":"pith","pith_arxiv_id":"2203.09418","snapshot_observed_at":"2026-08-05T13:46:50.386265Z","title":"ZebraPose: Coarse to Fine Surface Encoding for 6DoF Object Pose Estimation","venue":"cs.CV","work_id":"7297723c-5846-4657-b985-dbe01bc750bc","year":2022},"citing_paper":{"arxiv_id":"2509.00361","last_updated":"2025-08-30T04:53:32Z","snapshot_observed_at":"2026-08-14T20:37:46.603109Z","submitted_at":"2025-08-30T04:53:32Z","title":"Generative Visual Foresight Meets Task-Agnostic Pose Estimation in Robotic Table-Top Manipulation","version":1},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-08-05T13:46:43.014343Z"},"links":{"cited_paper":"/paper/2203.09418","citing_paper":"/paper/2509.00361"},"observation_digest":"sha256:3be8a63f695bfcaa2b6c00aed661e3b59eb39876785c457daf9ae803ec295bb1","observation_id":"89913f19-c4fe-4d6c-8ae1-df9afdc150c7","resolution":{"observed_at":"2026-08-05T13:46:50.454729Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T13:46:52.904240Z","title":"Zakharov, I","venue":null,"work_id":"56e6fea1-7d2b-4585-a863-0253c1b80fcf","year":2019},"citing_paper":{"arxiv_id":"2509.00361","last_updated":"2025-08-30T04:53:32Z","snapshot_observed_at":"2026-08-14T20:37:46.603109Z","submitted_at":"2025-08-30T04:53:32Z","title":"Generative Visual Foresight Meets Task-Agnostic Pose Estimation in Robotic Table-Top Manipulation","version":1},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-08-05T13:46:43.074416Z"},"links":{"citing_paper":"/paper/2509.00361"},"observation_digest":"sha256:1336c09d962fd9d8df9f3aa4c735089928f3bbc5e91feb032bf48cc64f333757","observation_id":"845c57b1-b90c-49ec-a1bf-8f104dd82519","resolution":{"observed_at":"2026-08-05T13:46:52.919124Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T13:46:52.865041Z","title":null,"venue":null,"work_id":"5ab9d1dc-8979-48c5-a225-307dc6354cd7","year":2022},"citing_paper":{"arxiv_id":"2509.00361","last_updated":"2025-08-30T04:53:32Z","snapshot_observed_at":"2026-08-14T20:37:46.603109Z","submitted_at":"2025-08-30T04:53:32Z","title":"Generative Visual Foresight Meets Task-Agnostic Pose Estimation in Robotic Table-Top Manipulation","version":1},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-08-05T13:46:43.124336Z"},"links":{"citing_paper":"/paper/2509.00361"},"observation_digest":"sha256:67092e14a7474a6255467b151564d3d2e00cd7ba9785d0dc201837ef814d3c6c","observation_id":"a53b0db7-c6d3-48b5-b9c5-34b8d53120af","resolution":{"observed_at":"2026-08-05T13:46:52.877129Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2203.13254","last_updated":"2022-08-11T14:38:50Z","snapshot_observed_at":"2026-08-13T16:15:47.700913Z","submitted_at":"2022-03-24T17:59:49Z","title":"EPro-PnP: Generalized End-to-End Probabilistic Perspective-n-Points for Monocular Object Pose Estimation","version":4},"cited_work":{"arxiv_id":"2203.13254","doi":null,"metadata_source":"pith","pith_arxiv_id":"2203.13254","snapshot_observed_at":"2026-08-05T13:46:50.253077Z","title":"EPro-PnP: Generalized End-to-End Probabilistic Perspective-n-Points for Monocular Object Pose Estimation","venue":"cs.CV","work_id":"2d452a6c-40c4-4066-8692-4fb4d434ba20","year":2022},"citing_paper":{"arxiv_id":"2509.00361","last_updated":"2025-08-30T04:53:32Z","snapshot_observed_at":"2026-08-14T20:37:46.603109Z","submitted_at":"2025-08-30T04:53:32Z","title":"Generative Visual Foresight Meets Task-Agnostic Pose Estimation in Robotic Table-Top Manipulation","version":1},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-08-05T13:46:43.216499Z"},"links":{"cited_paper":"/paper/2203.13254","citing_paper":"/paper/2509.00361"},"observation_digest":"sha256:a51ea7207ddaa80782ba2a624eb81763d0b09def3cb62d637919bd632cf51a01","observation_id":"3b23a736-06d3-43af-b179-9b8859b7821a","resolution":{"observed_at":"2026-08-05T13:46:50.311169Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2111.13489","last_updated":"2022-04-04T07:38:44Z","snapshot_observed_at":"2026-08-13T17:27:22.197291Z","submitted_at":"2021-11-26T13:39:38Z","title":"SurfEmb: Dense and Continuous Correspondence Distributions for Object Pose Estimation with Learnt Surface Embeddings","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2111.13489","snapshot_observed_at":"2026-08-05T13:46:43.312801Z","title":null,"venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2509.00361","last_updated":"2025-08-30T04:53:32Z","snapshot_observed_at":"2026-08-14T20:37:46.603109Z","submitted_at":"2025-08-30T04:53:32Z","title":"Generative Visual Foresight Meets Task-Agnostic Pose Estimation in Robotic Table-Top Manipulation","version":1},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-08-05T13:46:43.312801Z"},"links":{"cited_paper":"/paper/2111.13489","citing_paper":"/paper/2509.00361"},"observation_digest":"sha256:ca46043ae1418381ca7b24c9cf79181f2d7f7c9901f6121e101a6437fe073338","observation_id":"3c194759-8c3b-4a7c-bd37-72af9301ec4e","resolution":{"observed_at":"2026-08-05T13:46:43.312801Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T13:46:43.364738Z","title":"Tekin, S","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2509.00361","last_updated":"2025-08-30T04:53:32Z","snapshot_observed_at":"2026-08-14T20:37:46.603109Z","submitted_at":"2025-08-30T04:53:32Z","title":"Generative Visual Foresight Meets Task-Agnostic Pose Estimation in Robotic Table-Top Manipulation","version":1},"reference_index":36,"source":"pdf_text","source_observed_at":"2026-08-05T13:46:43.364738Z"},"links":{"citing_paper":"/paper/2509.00361"},"observation_digest":"sha256:de96e88e7c0bf52adb6f560036ac986b8ae865c814af565a681f7f6e8c8fe241","observation_id":"16c48553-1b8d-4bdf-a1dd-4cbbb5aa2af7","resolution":{"observed_at":"2026-08-05T13:46:43.364738Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T13:46:52.836992Z","title":null,"venue":null,"work_id":"cfa06268-4045-4c31-84d6-655c805d7d8b","year":2023},"citing_paper":{"arxiv_id":"2509.00361","last_updated":"2025-08-30T04:53:32Z","snapshot_observed_at":"2026-08-14T20:37:46.603109Z","submitted_at":"2025-08-30T04:53:32Z","title":"Generative Visual Foresight Meets Task-Agnostic Pose Estimation in Robotic Table-Top Manipulation","version":1},"reference_index":37,"source":"pdf_text","source_observed_at":"2026-08-05T13:46:43.417422Z"},"links":{"citing_paper":"/paper/2509.00361"},"observation_digest":"sha256:2eee5e18d6ee3b672defed2e611510d08eb50d1949f2f7e0a3989c77e9d87d04","observation_id":"f85261fd-3a42-429a-8597-c677863da204","resolution":{"observed_at":"2026-08-05T13:46:52.844222Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T13:46:52.728097Z","title":"Linfang, L","venue":null,"work_id":"e80e0ea3-014e-4f86-8e1b-42d136a706a9","year":2022},"citing_paper":{"arxiv_id":"2509.00361","last_updated":"2025-08-30T04:53:32Z","snapshot_observed_at":"2026-08-14T20:37:46.603109Z","submitted_at":"2025-08-30T04:53:32Z","title":"Generative Visual Foresight Meets Task-Agnostic Pose Estimation in Robotic Table-Top Manipulation","version":1},"reference_index":38,"source":"pdf_text","source_observed_at":"2026-08-05T13:46:43.486931Z"},"links":{"citing_paper":"/paper/2509.00361"},"observation_digest":"sha256:acef8216fd8750b015b99147bee69e8860e185987343b7a14a069e7088d300ce","observation_id":"3f184f02-4369-4670-99bc-36cd4b955f21","resolution":{"observed_at":"2026-08-05T13:46:52.810367Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T13:46:52.402137Z","title":null,"venue":null,"work_id":"e173f334-067b-4b9d-918a-3d6126bd6f79","year":2020},"citing_paper":{"arxiv_id":"2509.00361","last_updated":"2025-08-30T04:53:32Z","snapshot_observed_at":"2026-08-14T20:37:46.603109Z","submitted_at":"2025-08-30T04:53:32Z","title":"Generative Visual Foresight Meets Task-Agnostic Pose Estimation in Robotic Table-Top Manipulation","version":1},"reference_index":39,"source":"pdf_text","source_observed_at":"2026-08-05T13:46:43.529395Z"},"links":{"citing_paper":"/paper/2509.00361"},"observation_digest":"sha256:5d7a19afbffe3f82b410ce515055140eb518dcff5318f28a727be819053d4a8f","observation_id":"6543a10e-2314-46cc-91e3-283f9e668c7e","resolution":{"observed_at":"2026-08-05T13:46:52.580152Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2111.12580","last_updated":"2022-04-06T02:13:28Z","snapshot_observed_at":"2026-08-13T17:28:21.449161Z","submitted_at":"2021-11-24T16:00:48Z","title":"UDA-COPE: Unsupervised Domain Adaptation for Category-level Object Pose Estimation","version":2},"cited_work":{"arxiv_id":"2111.12580","doi":null,"metadata_source":"pith","pith_arxiv_id":"2111.12580","snapshot_observed_at":"2026-08-05T13:46:49.912694Z","title":"UDA-COPE: Unsupervised Domain Adaptation for Category-level Object Pose Estimation","venue":"cs.CV","work_id":"88d25e82-7c29-40ef-ac04-9407b6638669","year":2021},"citing_paper":{"arxiv_id":"2509.00361","last_updated":"2025-08-30T04:53:32Z","snapshot_observed_at":"2026-08-14T20:37:46.603109Z","submitted_at":"2025-08-30T04:53:32Z","title":"Generative Visual Foresight Meets Task-Agnostic Pose Estimation in Robotic Table-Top Manipulation","version":1},"reference_index":40,"source":"pdf_text","source_observed_at":"2026-08-05T13:46:43.581751Z"},"links":{"cited_paper":"/paper/2111.12580","citing_paper":"/paper/2509.00361"},"observation_digest":"sha256:a323d9a9a6dbe5f752e1ae70884d11ca68b1b5ddce657ab26018d01402d76833","observation_id":"2e2da9b9-3e29-4d46-9b01-8e0a8f621832","resolution":{"observed_at":"2026-08-05T13:46:49.965921Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T13:46:52.161355Z","title":null,"venue":null,"work_id":"ededab74-12ec-4787-bea4-e9af8139f521","year":2020},"citing_paper":{"arxiv_id":"2509.00361","last_updated":"2025-08-30T04:53:32Z","snapshot_observed_at":"2026-08-14T20:37:46.603109Z","submitted_at":"2025-08-30T04:53:32Z","title":"Generative Visual Foresight Meets Task-Agnostic Pose Estimation in Robotic Table-Top Manipulation","version":1},"reference_index":41,"source":"pdf_text","source_observed_at":"2026-08-05T13:46:43.662026Z"},"links":{"citing_paper":"/paper/2509.00361"},"observation_digest":"sha256:4d6d3c81fed574a26efafa2fd06aa7b711cbf491f7a400bcce0366dfb069b3a5","observation_id":"9fdbf2cf-8804-4c40-b72f-01e53252e67d","resolution":{"observed_at":"2026-08-05T13:46:52.218928Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2207.13691","last_updated":"2022-07-27T17:59:31Z","snapshot_observed_at":"2026-08-13T14:55:28.439814Z","submitted_at":"2022-07-27T17:59:31Z","title":"ShAPO: Implicit Representations for Multi-Object Shape, Appearance, and Pose Optimization","version":1},"cited_work":{"arxiv_id":"2207.13691","doi":null,"metadata_source":"pith","pith_arxiv_id":"2207.13691","snapshot_observed_at":"2026-08-05T13:46:49.574071Z","title":"ShAPO: Implicit Representations for Multi-Object Shape, Appearance, and Pose Optimization","venue":"cs.CV","work_id":"f2f9a479-151b-465a-885b-d78f7f5bc110","year":2022},"citing_paper":{"arxiv_id":"2509.00361","last_updated":"2025-08-30T04:53:32Z","snapshot_observed_at":"2026-08-14T20:37:46.603109Z","submitted_at":"2025-08-30T04:53:32Z","title":"Generative Visual Foresight Meets Task-Agnostic Pose Estimation in Robotic Table-Top Manipulation","version":1},"reference_index":42,"source":"pdf_text","source_observed_at":"2026-08-05T13:46:43.700214Z"},"links":{"cited_paper":"/paper/2207.13691","citing_paper":"/paper/2509.00361"},"observation_digest":"sha256:ce7eaf9939dcc2e2585f0bc0db17df9715ce51f3a7ca52a451d2e5beb7960a55","observation_id":"90b1c3bc-6822-4ee3-89eb-57006e0f33e9","resolution":{"observed_at":"2026-08-05T13:46:49.805872Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2404.11139","last_updated":"2024-04-17T07:34:21Z","snapshot_observed_at":"2026-08-13T00:28:31.226073Z","submitted_at":"2024-04-17T07:34:21Z","title":"GeoReF: Geometric Alignment Across Shape Variation for Category-level Object Pose Refinement","version":1},"cited_work":{"arxiv_id":"2404.11139","doi":null,"metadata_source":"pith","pith_arxiv_id":"2404.11139","snapshot_observed_at":"2026-08-05T13:46:49.434096Z","title":"GeoReF: Geometric Alignment Across Shape Variation for Category-level Object Pose Refinement","venue":"cs.CV","work_id":"f922a1e3-b986-49f7-83ee-e762a2f77a19","year":2024},"citing_paper":{"arxiv_id":"2509.00361","last_updated":"2025-08-30T04:53:32Z","snapshot_observed_at":"2026-08-14T20:37:46.603109Z","submitted_at":"2025-08-30T04:53:32Z","title":"Generative Visual Foresight Meets Task-Agnostic Pose Estimation in Robotic Table-Top Manipulation","version":1},"reference_index":43,"source":"pdf_text","source_observed_at":"2026-08-05T13:46:43.745414Z"},"links":{"cited_paper":"/paper/2404.11139","citing_paper":"/paper/2509.00361"},"observation_digest":"sha256:013ff013535c45ee834bf88e30623612d22480b599040014492afe3eea100b8d","observation_id":"b0c25d50-2972-42d3-a013-39b492420cb1","resolution":{"observed_at":"2026-08-05T13:46:49.495636Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T13:46:43.859874Z","title":"Zheng, C","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2509.00361","last_updated":"2025-08-30T04:53:32Z","snapshot_observed_at":"2026-08-14T20:37:46.603109Z","submitted_at":"2025-08-30T04:53:32Z","title":"Generative Visual Foresight Meets Task-Agnostic Pose Estimation in Robotic Table-Top Manipulation","version":1},"reference_index":44,"source":"pdf_text","source_observed_at":"2026-08-05T13:46:43.859874Z"},"links":{"citing_paper":"/paper/2509.00361"},"observation_digest":"sha256:bd2035f16574d88b7e2d21e5681c35175f5a13d2070cc565f7e4ec189f41dfaa","observation_id":"8d46a4e9-7c43-4623-a2cd-702f57ff9f72","resolution":{"observed_at":"2026-08-05T13:46:43.859874Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2409.01652","last_updated":"2024-11-12T04:33:26Z","snapshot_observed_at":"2026-07-29T23:37:00.228879Z","submitted_at":"2024-09-03T06:45:22Z","title":"ReKep: Spatio-Temporal Reasoning of Relational Keypoint Constraints for Robotic Manipulation","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2409.01652","snapshot_observed_at":"2026-08-05T13:46:43.950437Z","title":"Huang, C","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2509.00361","last_updated":"2025-08-30T04:53:32Z","snapshot_observed_at":"2026-08-14T20:37:46.603109Z","submitted_at":"2025-08-30T04:53:32Z","title":"Generative Visual Foresight Meets Task-Agnostic Pose Estimation in Robotic Table-Top Manipulation","version":1},"reference_index":45,"source":"pdf_text","source_observed_at":"2026-08-05T13:46:43.950437Z"},"links":{"cited_paper":"/paper/2409.01652","citing_paper":"/paper/2509.00361"},"observation_digest":"sha256:d4dc5750c451249cce13cb7542b722155ca3a52706adb686fd1eb2cb97955066","observation_id":"2f5d29b2-4919-42f5-bc61-6b8b0fcbac9e","resolution":{"observed_at":"2026-08-05T13:46:43.950437Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T13:46:52.052162Z","title":null,"venue":null,"work_id":"56c4b3c3-b58c-43ac-898b-b0b306395285","year":2019},"citing_paper":{"arxiv_id":"2509.00361","last_updated":"2025-08-30T04:53:32Z","snapshot_observed_at":"2026-08-14T20:37:46.603109Z","submitted_at":"2025-08-30T04:53:32Z","title":"Generative Visual Foresight Meets Task-Agnostic Pose Estimation in Robotic Table-Top Manipulation","version":1},"reference_index":46,"source":"pdf_text","source_observed_at":"2026-08-05T13:46:44.010175Z"},"links":{"citing_paper":"/paper/2509.00361"},"observation_digest":"sha256:38373ae84266ea71acce428600319c60c3bf7ff52ec9767e00944556dd06c623","observation_id":"2d87681e-9a3a-4620-af7e-9752f9a6640c","resolution":{"observed_at":"2026-08-05T13:46:52.109942Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1911.09231","last_updated":"2020-04-23T19:22:25Z","snapshot_observed_at":"2026-08-10T20:15:46.358768Z","submitted_at":"2019-11-21T01:06:19Z","title":"Camera-to-Robot Pose Estimation from a Single Image","version":4},"cited_work":{"arxiv_id":"1911.09231","doi":null,"metadata_source":"pith","pith_arxiv_id":"1911.09231","snapshot_observed_at":"2026-08-05T13:46:49.012864Z","title":"Camera-to-Robot Pose Estimation from a Single Image","venue":"cs.RO","work_id":"cfa79f22-5f7e-490a-b1ea-a241cf3fcbad","year":2019},"citing_paper":{"arxiv_id":"2509.00361","last_updated":"2025-08-30T04:53:32Z","snapshot_observed_at":"2026-08-14T20:37:46.603109Z","submitted_at":"2025-08-30T04:53:32Z","title":"Generative Visual Foresight Meets Task-Agnostic Pose Estimation in Robotic Table-Top Manipulation","version":1},"reference_index":47,"source":"pdf_text","source_observed_at":"2026-08-05T13:46:44.113562Z"},"links":{"cited_paper":"/paper/1911.09231","citing_paper":"/paper/2509.00361"},"observation_digest":"sha256:465f8f27b164cbcda2833aa51480458dd671994a35e27afdae56c63474e09ce7","observation_id":"ee5d0559-d455-41c4-a716-7c3fea93c4b5","resolution":{"observed_at":"2026-08-05T13:46:49.132776Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2409.10441","last_updated":"2024-09-16T16:22:43Z","snapshot_observed_at":"2026-08-12T22:43:53.707861Z","submitted_at":"2024-09-16T16:22:43Z","title":"CtRNet-X: Camera-to-Robot Pose Estimation in Real-world Conditions Using a Single Camera","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2409.10441","snapshot_observed_at":"2026-08-05T13:46:44.183313Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2509.00361","last_updated":"2025-08-30T04:53:32Z","snapshot_observed_at":"2026-08-14T20:37:46.603109Z","submitted_at":"2025-08-30T04:53:32Z","title":"Generative Visual Foresight Meets Task-Agnostic Pose Estimation in Robotic Table-Top Manipulation","version":1},"reference_index":48,"source":"pdf_text","source_observed_at":"2026-08-05T13:46:44.183313Z"},"links":{"cited_paper":"/paper/2409.10441","citing_paper":"/paper/2509.00361"},"observation_digest":"sha256:3e600e971f50ac52f94b400fb84482d8fab1ff5d30b5f3fdda04b8a3e48d787f","observation_id":"4c5e547c-668b-48d3-8354-ad35a2df1ddd","resolution":{"observed_at":"2026-08-05T13:46:44.183313Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T13:46:51.887818Z","title":"Simoni, G","venue":null,"work_id":"aea033ef-f620-4691-a865-650d20ef4c4f","year":null},"citing_paper":{"arxiv_id":"2509.00361","last_updated":"2025-08-30T04:53:32Z","snapshot_observed_at":"2026-08-14T20:37:46.603109Z","submitted_at":"2025-08-30T04:53:32Z","title":"Generative Visual Foresight Meets Task-Agnostic Pose Estimation in Robotic Table-Top Manipulation","version":1},"reference_index":49,"source":"pdf_text","source_observed_at":"2026-08-05T13:46:44.268468Z"},"links":{"citing_paper":"/paper/2509.00361"},"observation_digest":"sha256:129212f0ed946681ec5cebef13534cefb7cd6dc97b5834799db2963239c03963","observation_id":"543b93b4-68f6-40c8-9c78-b7f0407a61cd","resolution":{"observed_at":"2026-08-05T13:46:51.972395Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2403.18259","last_updated":"2024-03-27T05:15:48Z","snapshot_observed_at":"2026-08-13T00:44:09.916308Z","submitted_at":"2024-03-27T05:15:48Z","title":"RoboKeyGen: Robot Pose and Joint Angles Estimation via Diffusion-based 3D Keypoint Generation","version":1},"cited_work":{"arxiv_id":"2403.18259","doi":null,"metadata_source":"pith","pith_arxiv_id":"2403.18259","snapshot_observed_at":"2026-08-05T13:46:48.453602Z","title":"RoboKeyGen: Robot Pose and Joint Angles Estimation via Diffusion-based 3D Keypoint Generation","venue":"cs.RO","work_id":"fbab5501-aa18-4a21-9e61-589e88a4a5ad","year":2024},"citing_paper":{"arxiv_id":"2509.00361","last_updated":"2025-08-30T04:53:32Z","snapshot_observed_at":"2026-08-14T20:37:46.603109Z","submitted_at":"2025-08-30T04:53:32Z","title":"Generative Visual Foresight Meets Task-Agnostic Pose Estimation in Robotic Table-Top Manipulation","version":1},"reference_index":50,"source":"pdf_text","source_observed_at":"2026-08-05T13:46:44.484263Z"},"links":{"cited_paper":"/paper/2403.18259","citing_paper":"/paper/2509.00361"},"observation_digest":"sha256:5952b2d39d682aa358193afd12f0fd3d8ae4e0515ec1c089e698593b4aa79672","observation_id":"d100bc37-e2c4-4c25-9fd8-520fda0a353f","resolution":{"observed_at":"2026-08-05T13:46:48.502392Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"2024.34928","doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T13:46:48.729195Z","title":null,"venue":null,"work_id":"c8c8a47d-d651-482b-8df9-48643af4ef5c","year":2024},"citing_paper":{"arxiv_id":"2509.00361","last_updated":"2025-08-30T04:53:32Z","snapshot_observed_at":"2026-08-14T20:37:46.603109Z","submitted_at":"2025-08-30T04:53:32Z","title":"Generative Visual Foresight Meets Task-Agnostic Pose Estimation in Robotic Table-Top Manipulation","version":1},"reference_index":51,"source":"pdf_text","source_observed_at":"2026-08-05T13:46:44.381801Z"},"links":{"citing_paper":"/paper/2509.00361"},"observation_digest":"sha256:74a08057cd682faedd72f237ad7f09d0514994fc0f8e3b8a6dc54a51607b1de9","observation_id":"27e73985-31a6-4f8b-a427-a63ee6c9aec2","resolution":{"observed_at":"2026-08-05T13:46:48.889260Z","resolver_source":"raw_fallback","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2312.08344","last_updated":"2024-03-26T19:25:53Z","snapshot_observed_at":"2026-08-14T04:56:16.566246Z","submitted_at":"2023-12-13T18:28:09Z","title":"FoundationPose: Unified 6D Pose Estimation and Tracking of Novel Objects","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2312.08344","snapshot_observed_at":"2026-08-05T13:46:44.662957Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2509.00361","last_updated":"2025-08-30T04:53:32Z","snapshot_observed_at":"2026-08-14T20:37:46.603109Z","submitted_at":"2025-08-30T04:53:32Z","title":"Generative Visual Foresight Meets Task-Agnostic Pose Estimation in Robotic Table-Top Manipulation","version":1},"reference_index":52,"source":"pdf_text","source_observed_at":"2026-08-05T13:46:44.662957Z"},"links":{"cited_paper":"/paper/2312.08344","citing_paper":"/paper/2509.00361"},"observation_digest":"sha256:f7999bbef93defa17fb76372bfff47ddbe7e70c3f7d20fddc0499897ec25ea99","observation_id":"eb6804db-1ac7-448e-a9cc-07b60c7d7dc6","resolution":{"observed_at":"2026-08-05T13:46:44.662957Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2104.09359","last_updated":"2021-04-19T14:48:29Z","snapshot_observed_at":"2026-08-13T19:37:29.154752Z","submitted_at":"2021-04-19T14:48:29Z","title":"Single-view robot pose and joint angle estimation via render & compare","version":1},"cited_work":{"arxiv_id":"2104.09359","doi":null,"metadata_source":"pith","pith_arxiv_id":"2104.09359","snapshot_observed_at":"2026-08-05T13:46:48.275213Z","title":"Single-view robot pose and joint angle estimation via render & compare","venue":"cs.CV","work_id":"ebedccfc-52cc-4957-9fae-84e2d0156ab1","year":2021},"citing_paper":{"arxiv_id":"2509.00361","last_updated":"2025-08-30T04:53:32Z","snapshot_observed_at":"2026-08-14T20:37:46.603109Z","submitted_at":"2025-08-30T04:53:32Z","title":"Generative Visual Foresight Meets Task-Agnostic Pose Estimation in Robotic Table-Top Manipulation","version":1},"reference_index":53,"source":"pdf_text","source_observed_at":"2026-08-05T13:46:44.558242Z"},"links":{"cited_paper":"/paper/2104.09359","citing_paper":"/paper/2509.00361"},"observation_digest":"sha256:4d685b05e94a6b5bdc43af6eb464908de8bbb8631fff7c3913407dd21bd10fb2","observation_id":"2623f24e-96cd-4f0d-bc39-21ce4e81fbe2","resolution":{"observed_at":"2026-08-05T13:46:48.337182Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T13:46:44.814669Z","title":"Cheng, Y","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2509.00361","last_updated":"2025-08-30T04:53:32Z","snapshot_observed_at":"2026-08-14T20:37:46.603109Z","submitted_at":"2025-08-30T04:53:32Z","title":"Generative Visual Foresight Meets Task-Agnostic Pose Estimation in Robotic Table-Top Manipulation","version":1},"reference_index":54,"source":"pdf_text","source_observed_at":"2026-08-05T13:46:44.814669Z"},"links":{"citing_paper":"/paper/2509.00361"},"observation_digest":"sha256:495a05c9b196f4a7c4746ae6fe0d8b2ca2c4a37f39320bcb76f5f42710206ad9","observation_id":"7471e147-37bb-4b4d-9242-4248629a656b","resolution":{"observed_at":"2026-08-05T13:46:44.814669Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2503.14051","last_updated":"2025-03-18T09:12:49Z","snapshot_observed_at":"2026-08-11T23:36:20.713712Z","submitted_at":"2025-03-18T09:12:49Z","title":"Foundation Feature-Driven Online End-Effector Pose Estimation: A Marker-Free and Learning-Free Approach","version":1},"cited_work":{"arxiv_id":"2503.14051","doi":null,"metadata_source":"pith","pith_arxiv_id":"2503.14051","snapshot_observed_at":"2026-08-05T13:46:48.133570Z","title":"Foundation Feature-Driven Online End-Effector Pose Estimation: A Marker-Free and Learning-Free Approach","venue":"cs.RO","work_id":"130daea9-adc1-4a27-b090-a16892078280","year":2025},"citing_paper":{"arxiv_id":"2509.00361","last_updated":"2025-08-30T04:53:32Z","snapshot_observed_at":"2026-08-14T20:37:46.603109Z","submitted_at":"2025-08-30T04:53:32Z","title":"Generative Visual Foresight Meets Task-Agnostic Pose Estimation in Robotic Table-Top Manipulation","version":1},"reference_index":55,"source":"pdf_text","source_observed_at":"2026-08-05T13:46:44.738612Z"},"links":{"cited_paper":"/paper/2503.14051","citing_paper":"/paper/2509.00361"},"observation_digest":"sha256:b943104a4290cf31bbc10603053d75613bc1c813f869664be3829a0f8bd19005","observation_id":"de0651fd-4d71-472c-b830-c18794b4a1a0","resolution":{"observed_at":"2026-08-05T13:46:48.172502Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2209.03003","last_updated":"2022-09-07T08:59:55Z","snapshot_observed_at":"2026-07-06T13:49:40.974495Z","submitted_at":"2022-09-07T08:59:55Z","title":"Flow Straight and Fast: Learning to Generate and Transfer Data with Rectified Flow","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2209.03003","snapshot_observed_at":"2026-08-05T13:46:45.060814Z","title":null,"venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2509.00361","last_updated":"2025-08-30T04:53:32Z","snapshot_observed_at":"2026-08-14T20:37:46.603109Z","submitted_at":"2025-08-30T04:53:32Z","title":"Generative Visual Foresight Meets Task-Agnostic Pose Estimation in Robotic Table-Top Manipulation","version":1},"reference_index":56,"source":"pdf_text","source_observed_at":"2026-08-05T13:46:45.060814Z"},"links":{"cited_paper":"/paper/2209.03003","citing_paper":"/paper/2509.00361"},"observation_digest":"sha256:1b947406305370b1f1bf721889a63f4da1de7c1181c2af01d519c7f58cad09d2","observation_id":"1da652ed-ddd4-4e62-91e4-f2a70d958316","resolution":{"observed_at":"2026-08-05T13:46:45.060814Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2501.12375","last_updated":"2025-06-15T03:50:49Z","snapshot_observed_at":"2026-08-14T20:36:02.196652Z","submitted_at":"2025-01-21T18:53:30Z","title":"Video Depth Anything: Consistent Depth Estimation for Super-Long Videos","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2501.12375","snapshot_observed_at":"2026-08-05T13:46:44.930591Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2509.00361","last_updated":"2025-08-30T04:53:32Z","snapshot_observed_at":"2026-08-14T20:37:46.603109Z","submitted_at":"2025-08-30T04:53:32Z","title":"Generative Visual Foresight Meets Task-Agnostic Pose Estimation in Robotic Table-Top Manipulation","version":1},"reference_index":57,"source":"pdf_text","source_observed_at":"2026-08-05T13:46:44.930591Z"},"links":{"cited_paper":"/paper/2501.12375","citing_paper":"/paper/2509.00361"},"observation_digest":"sha256:1b352ac089e6e926d289e31b86c61f0ddaa806312e1ff0825fe9a90dd5e5b065","observation_id":"c11040f0-350d-4e24-a23f-8f6aa3498ec0","resolution":{"observed_at":"2026-08-05T13:46:44.930591Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2103.00020","last_updated":"2021-02-26T19:04:58Z","snapshot_observed_at":"2026-07-06T10:45:03.059688Z","submitted_at":"2021-02-26T19:04:58Z","title":"Learning Transferable Visual Models From Natural Language Supervision","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2103.00020","snapshot_observed_at":"2026-08-05T13:46:45.315475Z","title":"Radford, J","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2509.00361","last_updated":"2025-08-30T04:53:32Z","snapshot_observed_at":"2026-08-14T20:37:46.603109Z","submitted_at":"2025-08-30T04:53:32Z","title":"Generative Visual Foresight Meets Task-Agnostic Pose Estimation in Robotic Table-Top Manipulation","version":1},"reference_index":58,"source":"pdf_text","source_observed_at":"2026-08-05T13:46:45.315475Z"},"links":{"cited_paper":"/paper/2103.00020","citing_paper":"/paper/2509.00361"},"observation_digest":"sha256:0c60a44c3246b0260c2580a7b02bf4d8ceaef5d137b1ef705e90c272c32ee00c","observation_id":"92144d53-003f-4349-87bf-8085d6c8e8d0","resolution":{"observed_at":"2026-08-05T13:46:45.315475Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T13:46:51.730761Z","title":"Zheng, X","venue":null,"work_id":"a57cb7a0-9936-4bb6-9f37-d910a433f8fa","year":2024},"citing_paper":{"arxiv_id":"2509.00361","last_updated":"2025-08-30T04:53:32Z","snapshot_observed_at":"2026-08-14T20:37:46.603109Z","submitted_at":"2025-08-30T04:53:32Z","title":"Generative Visual Foresight Meets Task-Agnostic Pose Estimation in Robotic Table-Top Manipulation","version":1},"reference_index":59,"source":"pdf_text","source_observed_at":"2026-08-05T13:46:45.230031Z"},"links":{"citing_paper":"/paper/2509.00361"},"observation_digest":"sha256:7fcee8bafe9c278d52d75d5890afb1faa157c182fcfed6a12c25ab2339e06871","observation_id":"d6c42801-1bc5-49c3-8ceb-fc0f1ec263c1","resolution":{"observed_at":"2026-08-05T13:46:51.752616Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T13:46:51.558098Z","title":null,"venue":null,"work_id":"eaa5850e-3dae-459a-885c-b81017740f71","year":2023},"citing_paper":{"arxiv_id":"2509.00361","last_updated":"2025-08-30T04:53:32Z","snapshot_observed_at":"2026-08-14T20:37:46.603109Z","submitted_at":"2025-08-30T04:53:32Z","title":"Generative Visual Foresight Meets Task-Agnostic Pose Estimation in Robotic Table-Top Manipulation","version":1},"reference_index":60,"source":"pdf_text","source_observed_at":"2026-08-05T13:46:45.532609Z"},"links":{"citing_paper":"/paper/2509.00361"},"observation_digest":"sha256:313339597d2bb2ceb42c33d210251a995a265d1b15cfe659d4b4d5da4e17db22","observation_id":"19dabf07-def1-40fd-811d-ba892e781d5d","resolution":{"observed_at":"2026-08-05T13:46:51.638815Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2010.11929","last_updated":"2021-06-03T13:08:56Z","snapshot_observed_at":"2026-08-13T14:19:26.598265Z","submitted_at":"2020-10-22T17:55:59Z","title":"An Image is Worth 16x16 Words: Transformers for Image Recognition at Scale","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2010.11929","snapshot_observed_at":"2026-08-05T13:46:45.403072Z","title":"Dosovitskiy, L","venue":null,"work_id":null,"year":2010},"citing_paper":{"arxiv_id":"2509.00361","last_updated":"2025-08-30T04:53:32Z","snapshot_observed_at":"2026-08-14T20:37:46.603109Z","submitted_at":"2025-08-30T04:53:32Z","title":"Generative Visual Foresight Meets Task-Agnostic Pose Estimation in Robotic Table-Top Manipulation","version":1},"reference_index":61,"source":"pdf_text","source_observed_at":"2026-08-05T13:46:45.403072Z"},"links":{"cited_paper":"/paper/2010.11929","citing_paper":"/paper/2509.00361"},"observation_digest":"sha256:4c2b6f680d9f3999a20ba236e639c55cc637e8205f2fc77068b90dacec0096a0","observation_id":"05f7fdb8-b206-48b6-a0e5-5a65a19aca62","resolution":{"observed_at":"2026-08-05T13:46:45.403072Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T13:46:45.846958Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2509.00361","last_updated":"2025-08-30T04:53:32Z","snapshot_observed_at":"2026-08-14T20:37:46.603109Z","submitted_at":"2025-08-30T04:53:32Z","title":"Generative Visual Foresight Meets Task-Agnostic Pose Estimation in Robotic Table-Top Manipulation","version":1},"reference_index":62,"source":"pdf_text","source_observed_at":"2026-08-05T13:46:45.846958Z"},"links":{"citing_paper":"/paper/2509.00361"},"observation_digest":"sha256:59856f9ca838a4021e8d0172710b31c796c815f6e737ff3912760f8daf649a38","observation_id":"7815ea1b-fb14-4404-8c61-31290f218d68","resolution":{"observed_at":"2026-08-05T13:46:45.846958Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T13:46:51.374230Z","title":"Baker, I","venue":null,"work_id":"4780ba73-c7a5-432e-93ed-5890fe54928c","year":null},"citing_paper":{"arxiv_id":"2509.00361","last_updated":"2025-08-30T04:53:32Z","snapshot_observed_at":"2026-08-14T20:37:46.603109Z","submitted_at":"2025-08-30T04:53:32Z","title":"Generative Visual Foresight Meets Task-Agnostic Pose Estimation in Robotic Table-Top Manipulation","version":1},"reference_index":63,"source":"pdf_text","source_observed_at":"2026-08-05T13:46:45.619632Z"},"links":{"citing_paper":"/paper/2509.00361"},"observation_digest":"sha256:de83d025f50af44ea79eae86a2651a52072177822c062dad5fe5ba3acfeeb382","observation_id":"de554558-61f9-4fb8-a2cf-08f91408270e","resolution":{"observed_at":"2026-08-05T13:46:51.474578Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2010.02502","last_updated":"2022-10-05T20:19:21Z","snapshot_observed_at":"2026-08-11T15:38:14.931716Z","submitted_at":"2020-10-06T06:15:51Z","title":"Denoising Diffusion Implicit Models","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2010.02502","snapshot_observed_at":"2026-08-05T13:46:45.992940Z","title":null,"venue":null,"work_id":null,"year":2010},"citing_paper":{"arxiv_id":"2509.00361","last_updated":"2025-08-30T04:53:32Z","snapshot_observed_at":"2026-08-14T20:37:46.603109Z","submitted_at":"2025-08-30T04:53:32Z","title":"Generative Visual Foresight Meets Task-Agnostic Pose Estimation in Robotic Table-Top Manipulation","version":1},"reference_index":64,"source":"pdf_text","source_observed_at":"2026-08-05T13:46:45.992940Z"},"links":{"cited_paper":"/paper/2010.02502","citing_paper":"/paper/2509.00361"},"observation_digest":"sha256:0e4f1de2492ae3dc7812b66bd2750d3ad0ce313a55c1f6d6e6e9145851c3e296","observation_id":"c9089ae7-6bb7-487f-bfaf-be48b18fcb62","resolution":{"observed_at":"2026-08-05T13:46:45.992940Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2501.15830","last_updated":"2025-05-19T02:40:18Z","snapshot_observed_at":"2026-07-06T20:26:31.558337Z","submitted_at":"2025-01-27T07:34:33Z","title":"SpatialVLA: Exploring Spatial Representations for Visual-Language-Action Model","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2501.15830","snapshot_observed_at":"2026-08-05T13:46:46.071296Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2509.00361","last_updated":"2025-08-30T04:53:32Z","snapshot_observed_at":"2026-08-14T20:37:46.603109Z","submitted_at":"2025-08-30T04:53:32Z","title":"Generative Visual Foresight Meets Task-Agnostic Pose Estimation in Robotic Table-Top Manipulation","version":1},"reference_index":65,"source":"pdf_text","source_observed_at":"2026-08-05T13:46:46.071296Z"},"links":{"cited_paper":"/paper/2501.15830","citing_paper":"/paper/2509.00361"},"observation_digest":"sha256:c8968882e875fab619521b1e3191a2ec065f6b70c3aa382c193650e7b22bbaf2","observation_id":"1284c179-f571-4499-9075-79e7daff4a1d","resolution":{"observed_at":"2026-08-05T13:46:46.071296Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T13:46:45.938102Z","title":null,"venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2509.00361","last_updated":"2025-08-30T04:53:32Z","snapshot_observed_at":"2026-08-14T20:37:46.603109Z","submitted_at":"2025-08-30T04:53:32Z","title":"Generative Visual Foresight Meets Task-Agnostic Pose Estimation in Robotic Table-Top Manipulation","version":1},"reference_index":66,"source":"pdf_text","source_observed_at":"2026-08-05T13:46:45.938102Z"},"links":{"citing_paper":"/paper/2509.00361"},"observation_digest":"sha256:95c81abe78b496fd267c0ed44f0a16ab4ded817e760ef9a7fcc1c0616dd242fe","observation_id":"0ce53cfd-604e-4e39-a0c6-e46e976fddb7","resolution":{"observed_at":"2026-08-05T13:46:45.938102Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2412.10345","last_updated":"2025-06-05T21:26:08Z","snapshot_observed_at":"2026-08-12T18:17:40.083518Z","submitted_at":"2024-12-13T18:40:51Z","title":"TraceVLA: Visual Trace Prompting Enhances Spatial-Temporal Awareness for Generalist Robotic Policies","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2412.10345","snapshot_observed_at":"2026-08-05T13:46:46.313353Z","title":"Zheng, Y","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2509.00361","last_updated":"2025-08-30T04:53:32Z","snapshot_observed_at":"2026-08-14T20:37:46.603109Z","submitted_at":"2025-08-30T04:53:32Z","title":"Generative Visual Foresight Meets Task-Agnostic Pose Estimation in Robotic Table-Top Manipulation","version":1},"reference_index":67,"source":"pdf_text","source_observed_at":"2026-08-05T13:46:46.313353Z"},"links":{"cited_paper":"/paper/2412.10345","citing_paper":"/paper/2509.00361"},"observation_digest":"sha256:f374f6cb51ec84714dc189b0b35f57b2bc32a13192d976c6c097f6aefd81abca","observation_id":"5d91e7c0-de91-4bea-9839-ad7bc8c05e21","resolution":{"observed_at":"2026-08-05T13:46:46.313353Z","resolver_source":null,"status":"malformed_identifier"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T13:46:46.210195Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2509.00361","last_updated":"2025-08-30T04:53:32Z","snapshot_observed_at":"2026-08-14T20:37:46.603109Z","submitted_at":"2025-08-30T04:53:32Z","title":"Generative Visual Foresight Meets Task-Agnostic Pose Estimation in Robotic Table-Top Manipulation","version":1},"reference_index":69,"source":"pdf_text","source_observed_at":"2026-08-05T13:46:46.210195Z"},"links":{"citing_paper":"/paper/2509.00361"},"observation_digest":"sha256:ddbfd72e9088063d0f3f8e0a1878020e430e6c309060ff59968d55c249a32d6e","observation_id":"825d5de9-3834-46a5-b771-65f81723c67e","resolution":{"observed_at":"2026-08-05T13:46:46.210195Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2206.11795","last_updated":"2022-06-23T16:01:11Z","snapshot_observed_at":"2026-08-13T15:17:59.520407Z","submitted_at":"2022-06-23T16:01:11Z","title":"Video PreTraining (VPT): Learning to Act by Watching Unlabeled Online Videos","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2206.11795","snapshot_observed_at":"2026-08-05T13:46:45.747217Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2509.00361","last_updated":"2025-08-30T04:53:32Z","snapshot_observed_at":"2026-08-14T20:37:46.603109Z","submitted_at":"2025-08-30T04:53:32Z","title":"Generative Visual Foresight Meets Task-Agnostic Pose Estimation in Robotic Table-Top Manipulation","version":1},"reference_index":2022,"source":"pdf_text","source_observed_at":"2026-08-05T13:46:45.747217Z"},"links":{"cited_paper":"/paper/2206.11795","citing_paper":"/paper/2509.00361"},"observation_digest":"sha256:e5e2b37c4e0dcc197cb4227372420a160d2e6c274d1ea5af9cd75e1665e96020","observation_id":"6737d5a0-3899-4a16-84f7-71eba7eb3c2a","resolution":{"observed_at":"2026-08-05T13:46:45.747217Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2411.07223","last_updated":"2025-03-12T17:03:25Z","snapshot_observed_at":"2026-08-12T22:03:00.228728Z","submitted_at":"2024-11-11T18:43:44Z","title":"Grounding Video Models to Actions through Goal Conditioned Exploration","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2411.07223","snapshot_observed_at":"2026-08-05T13:46:42.119053Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2509.00361","last_updated":"2025-08-30T04:53:32Z","snapshot_observed_at":"2026-08-14T20:37:46.603109Z","submitted_at":"2025-08-30T04:53:32Z","title":"Generative Visual Foresight Meets Task-Agnostic Pose Estimation in Robotic Table-Top Manipulation","version":1},"reference_index":2024,"source":"pdf_text","source_observed_at":"2026-08-05T13:46:42.119053Z"},"links":{"cited_paper":"/paper/2411.07223","citing_paper":"/paper/2509.00361"},"observation_digest":"sha256:bffce8f157d5b316da4f3452d633da230795d239343a930474e7ecc3cd842e57","observation_id":"7c0ecbae-d3d8-4323-8457-0a184ab58190","resolution":{"observed_at":"2026-08-05T13:46:42.119053Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"paper":{"arxiv_id":"2509.00361","last_updated":"2025-08-30T04:53:32Z","latest_version":1,"primary_category":"cs.RO","snapshot_observed_at":"2026-08-14T20:37:46.603109Z","submitted_at":"2025-08-30T04:53:32Z","title":"Generative Visual Foresight Meets Task-Agnostic Pose Estimation in Robotic Table-Top Manipulation"},"reference_resolution":{"displayed":69,"state_counts":{"malformed_identifier":2,"metadata_mismatch":1,"parse_uncertain":0,"unresolved":46,"verified_exact":12,"verified_fuzzy":8},"total_outbound_references":69},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"thesis":"As of 15 August 2026, this Paper Citation Record lists 69 of 69 outbound references and 5 inbound Pith citation observations for arXiv:2509.00361."}