{"as_of":"2026-08-10T00:34:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:64ce778753109093b1db2c690077ef0244c9f2ac2db760a443d3027616fe211c","coverage":[{"denominator":135,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":100,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-07T04:58:54.442710Z","state":"measured"},{"denominator":107,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":107,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-09T06:31:02.800959+00:00","state":"measured"},{"denominator":7,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":7,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-08T18:01:16.629217Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"arxiv_reference","source_observed_at":"2026-07-04T13:29:51.374178Z","state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2506.09284","last_updated":"2025-08-25T19:45:29Z","snapshot_observed_at":"2026-08-08T15:02:00.662012Z","submitted_at":"2025-06-10T22:47:16Z","title":"UAD: Unsupervised Affordance Distillation for Generalization in Robotic Manipulation","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2506.09284","snapshot_observed_at":"2026-08-04T23:55:43.237396Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2509.06233","last_updated":"2025-09-07T22:45:06Z","snapshot_observed_at":"2026-08-08T15:02:43.738789Z","submitted_at":"2025-09-07T22:45:06Z","title":"O$^3$Afford: One-Shot 3D Object-to-Object Affordance Grounding for Generalizable Robotic Manipulation","version":1},"reference_index":59,"source":"pdf_text","source_observed_at":"2026-08-04T23:55:43.237396Z"},"links":{"cited_paper":"/paper/2506.09284","citing_paper":"/paper/2509.06233"},"observation_digest":"sha256:3eaac44b50104984df0c129c2829eb300e44127e0b2df34bbcde5a0b120130d9","observation_id":"6cd554e9-e642-4c18-bc2d-36fcc1ccb097","resolution":{"observed_at":"2026-08-04T23:55:43.237396Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2506.09284","last_updated":"2025-08-25T19:45:29Z","snapshot_observed_at":"2026-08-08T15:02:00.662012Z","submitted_at":"2025-06-10T22:47:16Z","title":"UAD: Unsupervised Affordance Distillation for Generalization in Robotic Manipulation","version":2},"cited_work":{"arxiv_id":"2506.09284","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2506.09284","snapshot_observed_at":"2026-07-04T13:29:51.374178Z","title":"Uad: Unsupervised affordance distillation for generalization in robotic manipulation","venue":null,"work_id":"19aadebf-17f0-42c7-bafd-ab1e4f545438","year":2025},"citing_paper":{"arxiv_id":"2509.19102","last_updated":"2026-05-17T17:21:02Z","snapshot_observed_at":"2026-07-06T22:30:36.671861Z","submitted_at":"2025-09-23T14:49:05Z","title":"FUNCanon: Learning Pose-Aware Action Primitives via Functional Object Canonicalization for Generalizable Robotic Manipulation","version":2},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-05-21T22:15:10.709760Z"},"links":{"cited_paper":"/paper/2506.09284","citing_paper":"/paper/2509.19102"},"observation_digest":"sha256:18cf8d61046c61fed1326774a353cbacef9176a947ca5922b76d8a34ef5d3814","observation_id":"56a9b232-db5b-4a71-8a53-55d83c6a72d2","resolution":{"observed_at":"2026-05-21T22:15:41.936416Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2506.09284","last_updated":"2025-08-25T19:45:29Z","snapshot_observed_at":"2026-08-08T15:02:00.662012Z","submitted_at":"2025-06-10T22:47:16Z","title":"UAD: Unsupervised Affordance Distillation for Generalization in Robotic Manipulation","version":2},"cited_work":{"arxiv_id":"2506.09284","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2506.09284","snapshot_observed_at":"2026-07-04T13:29:51.374178Z","title":"Uad: Unsupervised affordance distillation for generalization in robotic manipulation","venue":null,"work_id":"19aadebf-17f0-42c7-bafd-ab1e4f545438","year":2025},"citing_paper":{"arxiv_id":"2510.01433","last_updated":"2026-04-15T19:41:35Z","snapshot_observed_at":"2026-07-29T19:10:23.857765Z","submitted_at":"2025-10-01T20:13:39Z","title":"AFFORD2ACT: Affordance-Guided Automatic Keypoint Selection for Generalizable and Lightweight Robotic Manipulation","version":2},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-05-18T10:17:53.226866Z"},"links":{"cited_paper":"/paper/2506.09284","citing_paper":"/paper/2510.01433"},"observation_digest":"sha256:323b9823c106da959c15c8a74358d5b037f5ef908f24f7060b1fc54e1b6c9409","observation_id":"4a9f8d5c-7ad7-447b-a482-656535a2962f","resolution":{"observed_at":"2026-05-18T10:21:15.252945Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2506.09284","last_updated":"2025-08-25T19:45:29Z","snapshot_observed_at":"2026-08-08T15:02:00.662012Z","submitted_at":"2025-06-10T22:47:16Z","title":"UAD: Unsupervised Affordance Distillation for Generalization in Robotic Manipulation","version":2},"cited_work":{"arxiv_id":"2506.09284","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2506.09284","snapshot_observed_at":"2026-07-04T13:29:51.374178Z","title":"Uad: Unsupervised affordance distillation for generalization in robotic manipulation","venue":null,"work_id":"19aadebf-17f0-42c7-bafd-ab1e4f545438","year":2025},"citing_paper":{"arxiv_id":"2606.08655","last_updated":"2026-06-07T14:50:44Z","snapshot_observed_at":"2026-08-08T16:20:06.037796Z","submitted_at":"2026-06-07T14:50:44Z","title":"PhysGraph: A Physics-aware 3D Scene Graph for Perception and Reasoning","version":1},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-06-27T18:13:55.537524Z"},"links":{"cited_paper":"/paper/2506.09284","citing_paper":"/paper/2606.08655"},"observation_digest":"sha256:748c9f1362fe2c10645d43ca3ae6d5994c0e902d2edfbfe19718e7c0b7de0a53","observation_id":"4043f4c3-6df1-4da3-9d13-eb45b50bc92e","resolution":{"observed_at":"2026-07-02T23:27:27.449919Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2506.09284","last_updated":"2025-08-25T19:45:29Z","snapshot_observed_at":"2026-08-08T15:02:00.662012Z","submitted_at":"2025-06-10T22:47:16Z","title":"UAD: Unsupervised Affordance Distillation for Generalization in Robotic Manipulation","version":2},"cited_work":{"arxiv_id":"2506.09284","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2506.09284","snapshot_observed_at":"2026-07-04T13:29:51.374178Z","title":"Uad: Unsupervised affordance distillation for generalization in robotic manipulation","venue":null,"work_id":"19aadebf-17f0-42c7-bafd-ab1e4f545438","year":2025},"citing_paper":{"arxiv_id":"2606.27036","last_updated":"2026-06-25T13:42:26Z","snapshot_observed_at":"2026-08-08T19:40:53.952489Z","submitted_at":"2026-06-25T13:42:26Z","title":"RelAfford6D: Relational 6D Affordance Graphs for Constraint-Driven Robotic Manipulation","version":1},"reference_index":40,"source":"pdf_text","source_observed_at":"2026-06-26T05:12:52.994218Z"},"links":{"cited_paper":"/paper/2506.09284","citing_paper":"/paper/2606.27036"},"observation_digest":"sha256:0f2a1baa075982515f858fb056b19fe3490bd0eefdc0fb28b4bca04543cb07cf","observation_id":"21bbfbdb-2721-446c-b993-90b9053c1ea8","resolution":{"observed_at":"2026-07-04T13:29:51.375616Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2506.09284","last_updated":"2025-08-25T19:45:29Z","snapshot_observed_at":"2026-08-08T15:02:00.662012Z","submitted_at":"2025-06-10T22:47:16Z","title":"UAD: Unsupervised Affordance Distillation for Generalization in Robotic Manipulation","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2506.09284","snapshot_observed_at":"2026-07-12T11:41:59.158887Z","title":"https://arxiv.org/abs/2506.09284 (2025)","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.02549","last_updated":"2026-06-25T22:09:56Z","snapshot_observed_at":"2026-08-08T15:02:38.126648Z","submitted_at":"2026-06-25T22:09:56Z","title":"Learning 3D Affordances for Blade Insertion in Cluttered Stowing","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-07-12T11:41:59.158887Z"},"links":{"cited_paper":"/paper/2506.09284","citing_paper":"/paper/2607.02549"},"observation_digest":"sha256:b79a92c0aa7f1fa08f64083fb2b4cfa1cfc18b0cb3e852e0879ebd5607ff801a","observation_id":"a4bc107a-92b2-4b83-81c2-58893c2c8a04","resolution":{"observed_at":"2026-07-12T11:41:59.158887Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2506.09284","last_updated":"2025-08-25T19:45:29Z","snapshot_observed_at":"2026-08-08T15:02:00.662012Z","submitted_at":"2025-06-10T22:47:16Z","title":"UAD: Unsupervised Affordance Distillation for Generalization in Robotic Manipulation","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2506.09284","snapshot_observed_at":"2026-08-08T18:01:16.629217Z","title":"Uad: Unsupervised affordance distillation for gener- alization in robotic manipulation,","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2608.05215","last_updated":"2026-08-05T10:15:55Z","snapshot_observed_at":"2026-08-09T23:10:18.883068Z","submitted_at":"2026-08-05T10:15:55Z","title":"VLAff: Vision-Language-Affordance Model for Unified Actionable Affordances","version":1},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-08-08T18:01:16.629217Z"},"links":{"cited_paper":"/paper/2506.09284","citing_paper":"/paper/2608.05215"},"observation_digest":"sha256:4f270c359af26a6a69a3beec5f42a3e1675bd569e57cd4161459f38f866eb433","observation_id":"7d9ddb00-788c-4c53-af49-f5898a6771a5","resolution":{"observed_at":"2026-08-08T18:01:16.629217Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"links":{"evidence":"/evidence","html":"/paper/2506.09284/citation-record","integrity":"/paper/2506.09284/integrity","json":"/paper/2506.09284/citation-record.json","paper":"/paper/2506.09284"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:58:30.681659Z","title":"To afford or not to afford: A new formalization of affordances toward affordance-based robot control,","venue":null,"work_id":null,"year":2007},"citing_paper":{"arxiv_id":"2506.09284","last_updated":"2025-08-25T19:45:29Z","snapshot_observed_at":"2026-08-08T15:02:00.662012Z","submitted_at":"2025-06-10T22:47:16Z","title":"UAD: Unsupervised Affordance Distillation for Generalization in Robotic Manipulation","version":2},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-07T04:58:30.681659Z"},"links":{"citing_paper":"/paper/2506.09284"},"observation_digest":"sha256:ae1dcef53aec7852ec7a41e4d70840fb8d2c1e83b46be94854599bdc0e721214","observation_id":"19e8b9a2-f1fa-4670-a93f-2dea150ae7ab","resolution":{"observed_at":"2026-08-07T04:58:30.681659Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:58:31.351855Z","title":"Affordances from human videos as a versatile representation for robotics,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.09284","last_updated":"2025-08-25T19:45:29Z","snapshot_observed_at":"2026-08-08T15:02:00.662012Z","submitted_at":"2025-06-10T22:47:16Z","title":"UAD: Unsupervised Affordance Distillation for Generalization in Robotic Manipulation","version":2},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-07T04:58:31.351855Z"},"links":{"citing_paper":"/paper/2506.09284"},"observation_digest":"sha256:cc8b218369c2732a731ea590a28af881a4deba7430871303e7c30eeab5302cdf","observation_id":"bb9ee850-dc16-4e3c-9c0a-708d2647d80f","resolution":{"observed_at":"2026-08-07T04:58:31.351855Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:58:33.794425Z","title":"Ditto in the house: Building articulation models of indoor scenes through interactive perception,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.09284","last_updated":"2025-08-25T19:45:29Z","snapshot_observed_at":"2026-08-08T15:02:00.662012Z","submitted_at":"2025-06-10T22:47:16Z","title":"UAD: Unsupervised Affordance Distillation for Generalization in Robotic Manipulation","version":2},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-07T04:58:33.794425Z"},"links":{"citing_paper":"/paper/2506.09284"},"observation_digest":"sha256:c5d3be670cfeef573bd4d1ece11e03e8db2286bbc5906665b88ef619f3b8eca6","observation_id":"b39fab20-d013-4a93-a4dc-970afa3c8729","resolution":{"observed_at":"2026-08-07T04:58:33.794425Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:58:35.359203Z","title":"Affordances in psychology, neuroscience, and robotics: A survey,","venue":null,"work_id":null,"year":2016},"citing_paper":{"arxiv_id":"2506.09284","last_updated":"2025-08-25T19:45:29Z","snapshot_observed_at":"2026-08-08T15:02:00.662012Z","submitted_at":"2025-06-10T22:47:16Z","title":"UAD: Unsupervised Affordance Distillation for Generalization in Robotic Manipulation","version":2},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-07T04:58:35.359203Z"},"links":{"citing_paper":"/paper/2506.09284"},"observation_digest":"sha256:9642f421c616b329d6855cb1ff82fd9c84296fb1b93a83724105133e48fdba6e","observation_id":"e3943fe9-5529-48eb-afe4-0d0002898911","resolution":{"observed_at":"2026-08-07T04:58:35.359203Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:58:36.382491Z","title":"A brief review of affordance in robotic manipulation research,","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2506.09284","last_updated":"2025-08-25T19:45:29Z","snapshot_observed_at":"2026-08-08T15:02:00.662012Z","submitted_at":"2025-06-10T22:47:16Z","title":"UAD: Unsupervised Affordance Distillation for Generalization in Robotic Manipulation","version":2},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-07T04:58:36.382491Z"},"links":{"citing_paper":"/paper/2506.09284"},"observation_digest":"sha256:d1521ecb4e410e1bd857bdbb43d2bae8512f6571540fb0a2b605dc992ff5c789","observation_id":"be99691a-7fa5-476f-87d5-1a06caf53f45","resolution":{"observed_at":"2026-08-07T04:58:36.382491Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:58:39.806659Z","title":"Visual affordance and function understanding: A survey,","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2506.09284","last_updated":"2025-08-25T19:45:29Z","snapshot_observed_at":"2026-08-08T15:02:00.662012Z","submitted_at":"2025-06-10T22:47:16Z","title":"UAD: Unsupervised Affordance Distillation for Generalization in Robotic Manipulation","version":2},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-07T04:58:39.806659Z"},"links":{"citing_paper":"/paper/2506.09284"},"observation_digest":"sha256:13c9ec26d854c28b3fe405bdfbf2271ae1fefedb720b60176e424f6dbd0252af","observation_id":"e2fe8bfa-5788-4923-b167-3981c973a895","resolution":{"observed_at":"2026-08-07T04:58:39.806659Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:58:40.076269Z","title":"A survey of visual affordance recognition based on deep learning,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.09284","last_updated":"2025-08-25T19:45:29Z","snapshot_observed_at":"2026-08-08T15:02:00.662012Z","submitted_at":"2025-06-10T22:47:16Z","title":"UAD: Unsupervised Affordance Distillation for Generalization in Robotic Manipulation","version":2},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-07T04:58:40.076269Z"},"links":{"citing_paper":"/paper/2506.09284"},"observation_digest":"sha256:0d7817b9506eb450d694414a661c69d09dfb55afa6623f0e7db028d679a48544","observation_id":"d3deb891-c68f-4445-9f43-d683ce299352","resolution":{"observed_at":"2026-08-07T04:58:40.076269Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:58:41.466880Z","title":"A survey of semantic reasoning frameworks for robotic systems,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.09284","last_updated":"2025-08-25T19:45:29Z","snapshot_observed_at":"2026-08-08T15:02:00.662012Z","submitted_at":"2025-06-10T22:47:16Z","title":"UAD: Unsupervised Affordance Distillation for Generalization in Robotic Manipulation","version":2},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-07T04:58:41.466880Z"},"links":{"citing_paper":"/paper/2506.09284"},"observation_digest":"sha256:45f527a6de51b21c7b2701df058e4ebfec3072ecadb7d6f8de28a535f7dc9122","observation_id":"c065643b-b675-44f5-b9dc-3e942032f51f","resolution":{"observed_at":"2026-08-07T04:58:41.466880Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:58:43.490512Z","title":"Recent advances of deep robotic affordance learning: a reinforcement learning perspective,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.09284","last_updated":"2025-08-25T19:45:29Z","snapshot_observed_at":"2026-08-08T15:02:00.662012Z","submitted_at":"2025-06-10T22:47:16Z","title":"UAD: Unsupervised Affordance Distillation for Generalization in Robotic Manipulation","version":2},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-07T04:58:43.490512Z"},"links":{"citing_paper":"/paper/2506.09284"},"observation_digest":"sha256:21a5fdc0b3e1b39278695e0d43042a47885567ccc24bcf458df240ff6b7d5dc6","observation_id":"61f90d88-5b70-4eb9-b8fe-f39e30a8cd32","resolution":{"observed_at":"2026-08-07T04:58:43.490512Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:58:43.674169Z","title":"Gpt-4 technical report,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.09284","last_updated":"2025-08-25T19:45:29Z","snapshot_observed_at":"2026-08-08T15:02:00.662012Z","submitted_at":"2025-06-10T22:47:16Z","title":"UAD: Unsupervised Affordance Distillation for Generalization in Robotic Manipulation","version":2},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-07T04:58:43.674169Z"},"links":{"citing_paper":"/paper/2506.09284"},"observation_digest":"sha256:5804d482499c3b3ed9ea70008e689c49df7538991f6e979736c2092d17a8c800","observation_id":"af0d3b4f-4186-444f-85bb-fe16864ce4a7","resolution":{"observed_at":"2026-08-07T04:58:43.674169Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2312.11805","last_updated":"2025-05-09T21:04:06Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2023-12-19T02:39:27Z","title":"Gemini: A Family of Highly Capable Multimodal Models","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2312.11805","snapshot_observed_at":"2026-08-07T04:58:43.839685Z","title":"Gemini: a family of highly capable multimodal models,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.09284","last_updated":"2025-08-25T19:45:29Z","snapshot_observed_at":"2026-08-08T15:02:00.662012Z","submitted_at":"2025-06-10T22:47:16Z","title":"UAD: Unsupervised Affordance Distillation for Generalization in Robotic Manipulation","version":2},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-07T04:58:43.839685Z"},"links":{"cited_paper":"/paper/2312.11805","citing_paper":"/paper/2506.09284"},"observation_digest":"sha256:d8641d2d9de1c0f56968eb19a33af828d5b74f9396914d285a48c57cfc41d9a9","observation_id":"d666e44e-417f-4b3e-a866-387c9faf4d04","resolution":{"observed_at":"2026-08-07T04:58:43.839685Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2303.08774","last_updated":"2024-03-04T06:01:33Z","snapshot_observed_at":"2026-08-07T07:30:12.213965Z","submitted_at":"2023-03-15T17:15:04Z","title":"GPT-4 Technical Report","version":6},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2303.08774","snapshot_observed_at":"2026-08-07T04:58:44.003575Z","title":"Gpt-4 technical report,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.09284","last_updated":"2025-08-25T19:45:29Z","snapshot_observed_at":"2026-08-08T15:02:00.662012Z","submitted_at":"2025-06-10T22:47:16Z","title":"UAD: Unsupervised Affordance Distillation for Generalization in Robotic Manipulation","version":2},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-07T04:58:44.003575Z"},"links":{"cited_paper":"/paper/2303.08774","citing_paper":"/paper/2506.09284"},"observation_digest":"sha256:72f4faa9e2c2544b5f04851e5f347fdb3c7e146465f6aacff92dd0b2157fc9ba","observation_id":"f0a8176c-0b00-48b6-be42-b3cd498f04d8","resolution":{"observed_at":"2026-08-07T04:58:44.003575Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:58:44.137035Z","title":"Emerging properties in self-supervised vision trans- formers,","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2506.09284","last_updated":"2025-08-25T19:45:29Z","snapshot_observed_at":"2026-08-08T15:02:00.662012Z","submitted_at":"2025-06-10T22:47:16Z","title":"UAD: Unsupervised Affordance Distillation for Generalization in Robotic Manipulation","version":2},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-07T04:58:44.137035Z"},"links":{"citing_paper":"/paper/2506.09284"},"observation_digest":"sha256:7828f4bf83861af6a3bc2cc16c6ebdd98b00829a1c5bb770c1280b84e8f94a0f","observation_id":"7790e4cf-6e35-4d27-87d0-6dc71eedc310","resolution":{"observed_at":"2026-08-07T04:58:44.137035Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2304.07193","last_updated":"2024-02-02T10:24:09Z","snapshot_observed_at":"2026-08-09T18:02:17.307812Z","submitted_at":"2023-04-14T15:12:19Z","title":"DINOv2: Learning Robust Visual Features without Supervision","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2304.07193","snapshot_observed_at":"2026-08-07T04:58:44.266795Z","title":"Dinov2: Learning robust visual features without supervision,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.09284","last_updated":"2025-08-25T19:45:29Z","snapshot_observed_at":"2026-08-08T15:02:00.662012Z","submitted_at":"2025-06-10T22:47:16Z","title":"UAD: Unsupervised Affordance Distillation for Generalization in Robotic Manipulation","version":2},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-07T04:58:44.266795Z"},"links":{"cited_paper":"/paper/2304.07193","citing_paper":"/paper/2506.09284"},"observation_digest":"sha256:faba4d71b155ab54900854b7e121a9278db3559ed8fe48fa7fb2f709f096f6b1","observation_id":"5ff11940-2363-4524-909a-d9bf2fb1d55e","resolution":{"observed_at":"2026-08-07T04:58:44.266795Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2208.13196","last_updated":"2023-05-25T05:47:29Z","snapshot_observed_at":"2026-07-06T13:46:11.811720Z","submitted_at":"2022-08-28T10:32:47Z","title":"Grounded Affordance from Exocentric View","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2208.13196","snapshot_observed_at":"2026-08-07T04:58:44.421123Z","title":"Grounded affordance from exocentric view,","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2506.09284","last_updated":"2025-08-25T19:45:29Z","snapshot_observed_at":"2026-08-08T15:02:00.662012Z","submitted_at":"2025-06-10T22:47:16Z","title":"UAD: Unsupervised Affordance Distillation for Generalization in Robotic Manipulation","version":2},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-07T04:58:44.421123Z"},"links":{"cited_paper":"/paper/2208.13196","citing_paper":"/paper/2506.09284"},"observation_digest":"sha256:8704e6380dffc46849df917ce11d2b41ac96606b60dbd6eb5e088a4d6a487a7c","observation_id":"e3f79409-8a4b-4cfd-99ca-dd4a6fd9b044","resolution":{"observed_at":"2026-08-07T04:58:44.421123Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:58:44.571024Z","title":"Droid: A large-scale in-the-wild robot manipulation dataset,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.09284","last_updated":"2025-08-25T19:45:29Z","snapshot_observed_at":"2026-08-08T15:02:00.662012Z","submitted_at":"2025-06-10T22:47:16Z","title":"UAD: Unsupervised Affordance Distillation for Generalization in Robotic Manipulation","version":2},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-07T04:58:44.571024Z"},"links":{"citing_paper":"/paper/2506.09284"},"observation_digest":"sha256:a2d63ebaeb4a5f000059c217547a8b773b5948c3a0faa7c75879a5641a7cc253","observation_id":"619e33a8-d6fb-4bdb-89b3-b14a80874923","resolution":{"observed_at":"2026-08-07T04:58:44.571024Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:58:44.647200Z","title":"Learning state representations with robotic priors,","venue":null,"work_id":null,"year":2015},"citing_paper":{"arxiv_id":"2506.09284","last_updated":"2025-08-25T19:45:29Z","snapshot_observed_at":"2026-08-08T15:02:00.662012Z","submitted_at":"2025-06-10T22:47:16Z","title":"UAD: Unsupervised Affordance Distillation for Generalization in Robotic Manipulation","version":2},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-07T04:58:44.647200Z"},"links":{"citing_paper":"/paper/2506.09284"},"observation_digest":"sha256:d8b510542cade7531438407152c752ee20a5c6ac6d4e6db9317c3d86c245461f","observation_id":"ddee7633-09c5-41ca-ac4c-8f2167010cc2","resolution":{"observed_at":"2026-08-07T04:58:44.647200Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:58:44.715651Z","title":"Learning transferable visual models from natural language supervision,","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2506.09284","last_updated":"2025-08-25T19:45:29Z","snapshot_observed_at":"2026-08-08T15:02:00.662012Z","submitted_at":"2025-06-10T22:47:16Z","title":"UAD: Unsupervised Affordance Distillation for Generalization in Robotic Manipulation","version":2},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-07T04:58:44.715651Z"},"links":{"citing_paper":"/paper/2506.09284"},"observation_digest":"sha256:709c11bd8511945ebfde599047fc47fc48400c87aced6c0c455dc70f157f5d31","observation_id":"84773c6e-b52a-45bc-9697-0aa7af8612f9","resolution":{"observed_at":"2026-08-07T04:58:44.715651Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:58:44.807451Z","title":"The theory of affordances,","venue":null,"work_id":null,"year":1977},"citing_paper":{"arxiv_id":"2506.09284","last_updated":"2025-08-25T19:45:29Z","snapshot_observed_at":"2026-08-08T15:02:00.662012Z","submitted_at":"2025-06-10T22:47:16Z","title":"UAD: Unsupervised Affordance Distillation for Generalization in Robotic Manipulation","version":2},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-07T04:58:44.807451Z"},"links":{"citing_paper":"/paper/2506.09284"},"observation_digest":"sha256:b5095ed5923f5a730679a837a18898474ee013261d301db3851f8ba3fa983d20","observation_id":"eab956e4-f9d9-4873-b89f-0cd279c3ee3c","resolution":{"observed_at":"2026-08-07T04:58:44.807451Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:58:44.902308Z","title":"Norman, The design of everyday things: Revised and expanded edition","venue":null,"work_id":null,"year":2013},"citing_paper":{"arxiv_id":"2506.09284","last_updated":"2025-08-25T19:45:29Z","snapshot_observed_at":"2026-08-08T15:02:00.662012Z","submitted_at":"2025-06-10T22:47:16Z","title":"UAD: Unsupervised Affordance Distillation for Generalization in Robotic Manipulation","version":2},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-07T04:58:44.902308Z"},"links":{"citing_paper":"/paper/2506.09284"},"observation_digest":"sha256:bf370f57499107c9c0748533ffd88876426aed4d0351cabc2374776d9bcdb25a","observation_id":"cb289901-aac1-4415-a2fd-840416977ec2","resolution":{"observed_at":"2026-08-07T04:58:44.902308Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2104.00878","last_updated":"2021-08-14T00:57:59Z","snapshot_observed_at":"2026-07-06T10:55:57.085122Z","submitted_at":"2021-04-02T04:18:53Z","title":"Contrastively Learning Visual Attention as Affordance Cues from Demonstrations for Robotic Grasping","version":3},"cited_work":{"arxiv_id":"2104.00878","doi":null,"metadata_source":"pith","pith_arxiv_id":"2104.00878","snapshot_observed_at":"2026-08-07T04:58:59.787333Z","title":"Contrastively Learning Visual Attention as Affordance Cues from Demonstrations for Robotic Grasping","venue":"cs.RO","work_id":"d664f8cd-3e7d-4d8c-b23a-3f25cd73d1ff","year":2021},"citing_paper":{"arxiv_id":"2506.09284","last_updated":"2025-08-25T19:45:29Z","snapshot_observed_at":"2026-08-08T15:02:00.662012Z","submitted_at":"2025-06-10T22:47:16Z","title":"UAD: Unsupervised Affordance Distillation for Generalization in Robotic Manipulation","version":2},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-07T04:58:45.009276Z"},"links":{"cited_paper":"/paper/2104.00878","citing_paper":"/paper/2506.09284"},"observation_digest":"sha256:9369a58846b01e9b70441134220872691cca848875c15807fc5c5e027189d515","observation_id":"5bcaf4e7-ff37-4219-8cce-6c505bf3052b","resolution":{"observed_at":"2026-08-07T04:58:59.952682Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:58:45.180106Z","title":"Self-supervised visual descriptor learning for dense correspondence,","venue":null,"work_id":null,"year":2016},"citing_paper":{"arxiv_id":"2506.09284","last_updated":"2025-08-25T19:45:29Z","snapshot_observed_at":"2026-08-08T15:02:00.662012Z","submitted_at":"2025-06-10T22:47:16Z","title":"UAD: Unsupervised Affordance Distillation for Generalization in Robotic Manipulation","version":2},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-07T04:58:45.180106Z"},"links":{"citing_paper":"/paper/2506.09284"},"observation_digest":"sha256:31ae78366772aff4716131ec1fbca0003b5041433c7d7bca026e868925e18662","observation_id":"af89a593-db44-45ba-931d-46b71871e2f3","resolution":{"observed_at":"2026-08-07T04:58:45.180106Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1806.08756","last_updated":"2018-09-07T17:53:32Z","snapshot_observed_at":"2026-08-05T02:51:42.900972Z","submitted_at":"2018-06-22T16:38:01Z","title":"Dense Object Nets: Learning Dense Visual Object Descriptors By and For Robotic Manipulation","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1806.08756","snapshot_observed_at":"2026-08-07T04:58:45.337097Z","title":"Dense object nets: Learning dense visual object descriptors by and for robotic manipu- lation,","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2506.09284","last_updated":"2025-08-25T19:45:29Z","snapshot_observed_at":"2026-08-08T15:02:00.662012Z","submitted_at":"2025-06-10T22:47:16Z","title":"UAD: Unsupervised Affordance Distillation for Generalization in Robotic Manipulation","version":2},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-07T04:58:45.337097Z"},"links":{"cited_paper":"/paper/1806.08756","citing_paper":"/paper/2506.09284"},"observation_digest":"sha256:62f4341768267b3e2ac7854015cf1fb7d394a6ec1c11247f434b70459a3cbb43","observation_id":"31b503e7-d612-4b6f-92eb-46e297c14f94","resolution":{"observed_at":"2026-08-07T04:58:45.337097Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:58:45.607094Z","title":"kpam: Keypoint affordances for category-level robotic manipulation,","venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2506.09284","last_updated":"2025-08-25T19:45:29Z","snapshot_observed_at":"2026-08-08T15:02:00.662012Z","submitted_at":"2025-06-10T22:47:16Z","title":"UAD: Unsupervised Affordance Distillation for Generalization in Robotic Manipulation","version":2},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-07T04:58:45.607094Z"},"links":{"citing_paper":"/paper/2506.09284"},"observation_digest":"sha256:f574879428703bdc1eb190b8298126fbcd28d115c1f6fc133e75056b6ff3628b","observation_id":"8b189007-d278-4c7e-a9e4-a207bea059a5","resolution":{"observed_at":"2026-08-07T04:58:45.607094Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:58:45.753418Z","title":"Unsupervised learning of object key- points for perception and control,","venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2506.09284","last_updated":"2025-08-25T19:45:29Z","snapshot_observed_at":"2026-08-08T15:02:00.662012Z","submitted_at":"2025-06-10T22:47:16Z","title":"UAD: Unsupervised Affordance Distillation for Generalization in Robotic Manipulation","version":2},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-08-07T04:58:45.753418Z"},"links":{"citing_paper":"/paper/2506.09284"},"observation_digest":"sha256:cef85c1409662308d8a559f0048506c8d0b378e1f11a8223b2c1e05061cabf47","observation_id":"75531195-ff43-4430-bf1e-d7a098f0b1f2","resolution":{"observed_at":"2026-08-07T04:58:45.753418Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:58:45.870214Z","title":"Keto: Learning keypoint representations for tool manipulation,","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2506.09284","last_updated":"2025-08-25T19:45:29Z","snapshot_observed_at":"2026-08-08T15:02:00.662012Z","submitted_at":"2025-06-10T22:47:16Z","title":"UAD: Unsupervised Affordance Distillation for Generalization in Robotic Manipulation","version":2},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-08-07T04:58:45.870214Z"},"links":{"citing_paper":"/paper/2506.09284"},"observation_digest":"sha256:ca4cb84dbe27ffc2d8509561b604036fec9644bf89f15c2cc5554f401af2db0e","observation_id":"eb92a658-efb5-4168-ac6a-f941aead6c29","resolution":{"observed_at":"2026-08-07T04:58:45.870214Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:58:45.964437Z","title":"Learning rope manipulation policies using dense object descriptors trained on synthetic depth data,","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2506.09284","last_updated":"2025-08-25T19:45:29Z","snapshot_observed_at":"2026-08-08T15:02:00.662012Z","submitted_at":"2025-06-10T22:47:16Z","title":"UAD: Unsupervised Affordance Distillation for Generalization in Robotic Manipulation","version":2},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-08-07T04:58:45.964437Z"},"links":{"citing_paper":"/paper/2506.09284"},"observation_digest":"sha256:d0c90f6e3bddfa8bd3daff06dcd4c2d6bb3a80e4714f65012e9259b4a2cc9a79","observation_id":"e6167ff1-e089-417a-818b-e08a47e9a6d0","resolution":{"observed_at":"2026-08-07T04:58:45.964437Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2009.05085","last_updated":"2020-09-10T18:38:10Z","snapshot_observed_at":"2026-08-09T05:34:31.561216Z","submitted_at":"2020-09-10T18:38:10Z","title":"Keypoints into the Future: Self-Supervised Correspondence in Model-Based Reinforcement Learning","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2009.05085","snapshot_observed_at":"2026-08-07T04:58:46.127638Z","title":"Keypoints into the future: Self-supervised correspondence in model-based reinforcement learning,","venue":null,"work_id":null,"year":2009},"citing_paper":{"arxiv_id":"2506.09284","last_updated":"2025-08-25T19:45:29Z","snapshot_observed_at":"2026-08-08T15:02:00.662012Z","submitted_at":"2025-06-10T22:47:16Z","title":"UAD: Unsupervised Affordance Distillation for Generalization in Robotic Manipulation","version":2},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-08-07T04:58:46.127638Z"},"links":{"cited_paper":"/paper/2009.05085","citing_paper":"/paper/2506.09284"},"observation_digest":"sha256:a704349aabc0612a0c16c34dad44d5d22f5c3dc7c68d7906edca19a93e658cc2","observation_id":"62845579-1b71-4cbd-93f7-5ba61f1acf45","resolution":{"observed_at":"2026-08-07T04:58:46.127638Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:58:46.208571Z","title":"Unsupervised learning of visual 3d keypoints for control,","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2506.09284","last_updated":"2025-08-25T19:45:29Z","snapshot_observed_at":"2026-08-08T15:02:00.662012Z","submitted_at":"2025-06-10T22:47:16Z","title":"UAD: Unsupervised Affordance Distillation for Generalization in Robotic Manipulation","version":2},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-08-07T04:58:46.208571Z"},"links":{"citing_paper":"/paper/2506.09284"},"observation_digest":"sha256:8af5244dd7b15ab51441ade2ea2146c8005f0dd7f1b8cb58cc444a380933f33b","observation_id":"c4709331-e432-4906-b13a-89224588015d","resolution":{"observed_at":"2026-08-07T04:58:46.208571Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:58:46.366078Z","title":"Neural descriptor fields: Se (3)- equivariant object representations for manipulation,","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2506.09284","last_updated":"2025-08-25T19:45:29Z","snapshot_observed_at":"2026-08-08T15:02:00.662012Z","submitted_at":"2025-06-10T22:47:16Z","title":"UAD: Unsupervised Affordance Distillation for Generalization in Robotic Manipulation","version":2},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-08-07T04:58:46.366078Z"},"links":{"citing_paper":"/paper/2506.09284"},"observation_digest":"sha256:0af7605105c4125cb780b5009c3c62bd09e51c026260845150590d7031d527aa","observation_id":"a2b7d1aa-792a-49ce-a950-366fe7770b4c","resolution":{"observed_at":"2026-08-07T04:58:46.366078Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:58:46.495487Z","title":"Se (3)-equivariant relational rearrangement with neural descriptor fields,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.09284","last_updated":"2025-08-25T19:45:29Z","snapshot_observed_at":"2026-08-08T15:02:00.662012Z","submitted_at":"2025-06-10T22:47:16Z","title":"UAD: Unsupervised Affordance Distillation for Generalization in Robotic Manipulation","version":2},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-08-07T04:58:46.495487Z"},"links":{"citing_paper":"/paper/2506.09284"},"observation_digest":"sha256:1adeab61bc9bbf558ac8883c326d778fcbb4a43527518ae5b545427df626f9a5","observation_id":"046229ac-65d4-49b5-8dc5-18e1c2016a6f","resolution":{"observed_at":"2026-08-07T04:58:46.495487Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2308.15975","last_updated":"2023-08-31T15:29:44Z","snapshot_observed_at":"2026-08-02T05:52:28.378605Z","submitted_at":"2023-08-30T11:57:04Z","title":"RoboTAP: Tracking Arbitrary Points for Few-Shot Visual Imitation","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2308.15975","snapshot_observed_at":"2026-08-07T04:58:46.628203Z","title":"Robotap: Tracking arbitrary points for few-shot visual imitation,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.09284","last_updated":"2025-08-25T19:45:29Z","snapshot_observed_at":"2026-08-08T15:02:00.662012Z","submitted_at":"2025-06-10T22:47:16Z","title":"UAD: Unsupervised Affordance Distillation for Generalization in Robotic Manipulation","version":2},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-08-07T04:58:46.628203Z"},"links":{"cited_paper":"/paper/2308.15975","citing_paper":"/paper/2506.09284"},"observation_digest":"sha256:1d8203b582a6ffe4a5d051ab71e089a0b608ff522153b1e56c551038ca17ee1e","observation_id":"08c75aba-1f5a-462a-a17e-db6ff134cfbc","resolution":{"observed_at":"2026-08-07T04:58:46.628203Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:58:46.799301Z","title":"Local neural descriptor fields: Locally conditioned object represen- tations for manipulation,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.09284","last_updated":"2025-08-25T19:45:29Z","snapshot_observed_at":"2026-08-08T15:02:00.662012Z","submitted_at":"2025-06-10T22:47:16Z","title":"UAD: Unsupervised Affordance Distillation for Generalization in Robotic Manipulation","version":2},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-08-07T04:58:46.799301Z"},"links":{"citing_paper":"/paper/2506.09284"},"observation_digest":"sha256:d0a4bd0e88a498e782e583d5af997bc817c0bd5ecf1fe32d42ef2884e2c76443","observation_id":"362749c5-09e4-474f-ba88-b7c7792bfc25","resolution":{"observed_at":"2026-08-07T04:58:46.799301Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2401.00025","last_updated":"2024-07-12T12:51:00Z","snapshot_observed_at":"2026-07-06T17:09:59.848387Z","submitted_at":"2023-12-28T23:34:43Z","title":"Any-point Trajectory Modeling for Policy Learning","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2401.00025","snapshot_observed_at":"2026-08-07T04:58:46.936864Z","title":"Any-point trajectory modeling for policy learning,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.09284","last_updated":"2025-08-25T19:45:29Z","snapshot_observed_at":"2026-08-08T15:02:00.662012Z","submitted_at":"2025-06-10T22:47:16Z","title":"UAD: Unsupervised Affordance Distillation for Generalization in Robotic Manipulation","version":2},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-08-07T04:58:46.936864Z"},"links":{"cited_paper":"/paper/2401.00025","citing_paper":"/paper/2506.09284"},"observation_digest":"sha256:cebca685323a9fc5f47eecc97f5f71f417cf17e6b4c02179b7498efa2af2b100","observation_id":"65bfca8a-11c0-4bb8-b67a-6083fa6087ae","resolution":{"observed_at":"2026-08-07T04:58:46.936864Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:58:47.100054Z","title":"Track2act: Predicting point tracks from internet videos enables diverse zero-shot robot manipulation,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.09284","last_updated":"2025-08-25T19:45:29Z","snapshot_observed_at":"2026-08-08T15:02:00.662012Z","submitted_at":"2025-06-10T22:47:16Z","title":"UAD: Unsupervised Affordance Distillation for Generalization in Robotic Manipulation","version":2},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-08-07T04:58:47.100054Z"},"links":{"citing_paper":"/paper/2506.09284"},"observation_digest":"sha256:46526d04b609cda1081ce539653f166105d573a53661f8b97227a9b2a7d2c0ea","observation_id":"39649e02-f077-4e1f-8b5b-7c3de42f0572","resolution":{"observed_at":"2026-08-07T04:58:47.100054Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:58:47.261056Z","title":"An affordance keypoint detection network for robot manipulation,","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2506.09284","last_updated":"2025-08-25T19:45:29Z","snapshot_observed_at":"2026-08-08T15:02:00.662012Z","submitted_at":"2025-06-10T22:47:16Z","title":"UAD: Unsupervised Affordance Distillation for Generalization in Robotic Manipulation","version":2},"reference_index":36,"source":"pdf_text","source_observed_at":"2026-08-07T04:58:47.261056Z"},"links":{"citing_paper":"/paper/2506.09284"},"observation_digest":"sha256:cd75ec615f55b9bfc33aca87e425d40bc43a23b2bb1c8f68c8ff60246f9e9121","observation_id":"b703bcce-d429-41b3-958e-835982ce29ca","resolution":{"observed_at":"2026-08-07T04:58:47.261056Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2409.01652","last_updated":"2024-11-12T04:33:26Z","snapshot_observed_at":"2026-07-29T23:37:00.228879Z","submitted_at":"2024-09-03T06:45:22Z","title":"ReKep: Spatio-Temporal Reasoning of Relational Keypoint Constraints for Robotic Manipulation","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2409.01652","snapshot_observed_at":"2026-08-07T04:58:47.369469Z","title":"Rekep: Spatio- temporal reasoning of relational keypoint constraints for robotic manipulation,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.09284","last_updated":"2025-08-25T19:45:29Z","snapshot_observed_at":"2026-08-08T15:02:00.662012Z","submitted_at":"2025-06-10T22:47:16Z","title":"UAD: Unsupervised Affordance Distillation for Generalization in Robotic Manipulation","version":2},"reference_index":37,"source":"pdf_text","source_observed_at":"2026-08-07T04:58:47.369469Z"},"links":{"cited_paper":"/paper/2409.01652","citing_paper":"/paper/2506.09284"},"observation_digest":"sha256:b040b0a1fd22c3adc9e720bce8d782c1cbe529b226e59515d2501070f350b724","observation_id":"f1461771-fcaa-4893-b5be-fa47ac2586dc","resolution":{"observed_at":"2026-08-07T04:58:47.369469Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:58:47.445162Z","title":"Affordance detection of tool parts from geometric features,","venue":null,"work_id":null,"year":2015},"citing_paper":{"arxiv_id":"2506.09284","last_updated":"2025-08-25T19:45:29Z","snapshot_observed_at":"2026-08-08T15:02:00.662012Z","submitted_at":"2025-06-10T22:47:16Z","title":"UAD: Unsupervised Affordance Distillation for Generalization in Robotic Manipulation","version":2},"reference_index":38,"source":"pdf_text","source_observed_at":"2026-08-07T04:58:47.445162Z"},"links":{"citing_paper":"/paper/2506.09284"},"observation_digest":"sha256:392a6019ef34b811f1bee47e427a700f6bc6ff564ccab67a1e8801028516b2da","observation_id":"34884d01-2631-4290-9ba7-571277ae32d1","resolution":{"observed_at":"2026-08-07T04:58:47.445162Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:58:47.521498Z","title":"Affordance detection for task-specific grasping using deep learning,","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2506.09284","last_updated":"2025-08-25T19:45:29Z","snapshot_observed_at":"2026-08-08T15:02:00.662012Z","submitted_at":"2025-06-10T22:47:16Z","title":"UAD: Unsupervised Affordance Distillation for Generalization in Robotic Manipulation","version":2},"reference_index":39,"source":"pdf_text","source_observed_at":"2026-08-07T04:58:47.521498Z"},"links":{"citing_paper":"/paper/2506.09284"},"observation_digest":"sha256:37786810fe5cd310ab942f10d3a4737b95ccf936f5181c5e7bd3cbd8a24d2d31","observation_id":"898f8bda-842e-4b37-8f9d-bfbec3f46b91","resolution":{"observed_at":"2026-08-07T04:58:47.521498Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:58:47.599031Z","title":"Object-based affordances detection with convolutional neural net- works and dense conditional random fields,","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2506.09284","last_updated":"2025-08-25T19:45:29Z","snapshot_observed_at":"2026-08-08T15:02:00.662012Z","submitted_at":"2025-06-10T22:47:16Z","title":"UAD: Unsupervised Affordance Distillation for Generalization in Robotic Manipulation","version":2},"reference_index":40,"source":"pdf_text","source_observed_at":"2026-08-07T04:58:47.599031Z"},"links":{"citing_paper":"/paper/2506.09284"},"observation_digest":"sha256:a2dd6d33c71b0bb2c24a204784b1bd526488c99af79d416e1d1f59e7c90097bf","observation_id":"a46c268c-89fc-4090-ab79-236372b9e7c0","resolution":{"observed_at":"2026-08-07T04:58:47.599031Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:58:47.704460Z","title":"Affordancenet: An end-to-end deep learning approach for object affordance detection,","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2506.09284","last_updated":"2025-08-25T19:45:29Z","snapshot_observed_at":"2026-08-08T15:02:00.662012Z","submitted_at":"2025-06-10T22:47:16Z","title":"UAD: Unsupervised Affordance Distillation for Generalization in Robotic Manipulation","version":2},"reference_index":41,"source":"pdf_text","source_observed_at":"2026-08-07T04:58:47.704460Z"},"links":{"citing_paper":"/paper/2506.09284"},"observation_digest":"sha256:367073d2efbba0d739698296cbb2c0102cf1167b6a7dc83bb5cc066c455e52bf","observation_id":"762202d1-d371-484f-95aa-85e19c20bb9d","resolution":{"observed_at":"2026-08-07T04:58:47.704460Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:58:47.896212Z","title":"Toward affordance detection and ranking on novel objects for real-world robotic manip- ulation,","venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2506.09284","last_updated":"2025-08-25T19:45:29Z","snapshot_observed_at":"2026-08-08T15:02:00.662012Z","submitted_at":"2025-06-10T22:47:16Z","title":"UAD: Unsupervised Affordance Distillation for Generalization in Robotic Manipulation","version":2},"reference_index":42,"source":"pdf_text","source_observed_at":"2026-08-07T04:58:47.896212Z"},"links":{"citing_paper":"/paper/2506.09284"},"observation_digest":"sha256:b658b7d02352641b8ff7638641dbb6fab2800c857fee5cb202be500b9ec981bb","observation_id":"40121d3e-509a-40b4-b30d-02dc754a00c7","resolution":{"observed_at":"2026-08-07T04:58:47.896212Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:58:48.049614Z","title":"Learning dexterous grasping with object-centric visual affordances,","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2506.09284","last_updated":"2025-08-25T19:45:29Z","snapshot_observed_at":"2026-08-08T15:02:00.662012Z","submitted_at":"2025-06-10T22:47:16Z","title":"UAD: Unsupervised Affordance Distillation for Generalization in Robotic Manipulation","version":2},"reference_index":43,"source":"pdf_text","source_observed_at":"2026-08-07T04:58:48.049614Z"},"links":{"citing_paper":"/paper/2506.09284"},"observation_digest":"sha256:ca19120f8b1a5592b688c5a2b363fdd5c867b0eb1d43a5c18b8f7d0d25690551","observation_id":"ae2a15ce-b5bb-4875-bfce-48669aa85b37","resolution":{"observed_at":"2026-08-07T04:58:48.049614Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:58:48.164305Z","title":"Affordance learning for end-to-end visuomotor robot control,","venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2506.09284","last_updated":"2025-08-25T19:45:29Z","snapshot_observed_at":"2026-08-08T15:02:00.662012Z","submitted_at":"2025-06-10T22:47:16Z","title":"UAD: Unsupervised Affordance Distillation for Generalization in Robotic Manipulation","version":2},"reference_index":44,"source":"pdf_text","source_observed_at":"2026-08-07T04:58:48.164305Z"},"links":{"citing_paper":"/paper/2506.09284"},"observation_digest":"sha256:c920cd1056415f9f1ce80e25a89e0ca2cb00aa89245c99e61e8a362b08e4750d","observation_id":"cf50cacb-9ed4-4bee-b130-993bd2beba3a","resolution":{"observed_at":"2026-08-07T04:58:48.164305Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:58:48.250001Z","title":"Affordance learning from play for sample-efficient policy learning,","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2506.09284","last_updated":"2025-08-25T19:45:29Z","snapshot_observed_at":"2026-08-08T15:02:00.662012Z","submitted_at":"2025-06-10T22:47:16Z","title":"UAD: Unsupervised Affordance Distillation for Generalization in Robotic Manipulation","version":2},"reference_index":45,"source":"pdf_text","source_observed_at":"2026-08-07T04:58:48.250001Z"},"links":{"citing_paper":"/paper/2506.09284"},"observation_digest":"sha256:ff0aa21e1f8575e325ccee8968481287f6317975e7614914844e42f009ff2d77","observation_id":"29c7450f-8d75-479b-9fa6-ba481f2b20d7","resolution":{"observed_at":"2026-08-07T04:58:48.250001Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:58:48.382280Z","title":"Visual affordance pre- diction for guiding robot exploration,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.09284","last_updated":"2025-08-25T19:45:29Z","snapshot_observed_at":"2026-08-08T15:02:00.662012Z","submitted_at":"2025-06-10T22:47:16Z","title":"UAD: Unsupervised Affordance Distillation for Generalization in Robotic Manipulation","version":2},"reference_index":46,"source":"pdf_text","source_observed_at":"2026-08-07T04:58:48.382280Z"},"links":{"citing_paper":"/paper/2506.09284"},"observation_digest":"sha256:2c22f33c2e98747a0fbe382fb76290650e3b1dd552e4b2f60b9bb5083b55b2e5","observation_id":"c23841ac-e208-4f35-b0f5-ea74122bd413","resolution":{"observed_at":"2026-08-07T04:58:48.382280Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2407.18911","last_updated":"2024-07-26T17:59:52Z","snapshot_observed_at":"2026-07-06T18:52:34.247456Z","submitted_at":"2024-07-26T17:59:52Z","title":"HRP: Human Affordances for Robotic Pre-Training","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2407.18911","snapshot_observed_at":"2026-08-07T04:58:48.482260Z","title":"Hrp: Human af- fordances for robotic pre-training,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.09284","last_updated":"2025-08-25T19:45:29Z","snapshot_observed_at":"2026-08-08T15:02:00.662012Z","submitted_at":"2025-06-10T22:47:16Z","title":"UAD: Unsupervised Affordance Distillation for Generalization in Robotic Manipulation","version":2},"reference_index":47,"source":"pdf_text","source_observed_at":"2026-08-07T04:58:48.482260Z"},"links":{"cited_paper":"/paper/2407.18911","citing_paper":"/paper/2506.09284"},"observation_digest":"sha256:9509ca566417d031d7cdf2dda89639c03de474dbb0c703cbcc7f04c21cae90af","observation_id":"f153e561-133b-454d-85e7-b83de4f01ad6","resolution":{"observed_at":"2026-08-07T04:58:48.482260Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:58:48.617921Z","title":"Learning relational affordance models for robots in multi-object manipulation tasks,","venue":null,"work_id":null,"year":2012},"citing_paper":{"arxiv_id":"2506.09284","last_updated":"2025-08-25T19:45:29Z","snapshot_observed_at":"2026-08-08T15:02:00.662012Z","submitted_at":"2025-06-10T22:47:16Z","title":"UAD: Unsupervised Affordance Distillation for Generalization in Robotic Manipulation","version":2},"reference_index":48,"source":"pdf_text","source_observed_at":"2026-08-07T04:58:48.617921Z"},"links":{"citing_paper":"/paper/2506.09284"},"observation_digest":"sha256:aaf8cab3fd7932d7ccaae571ae861fe049fb8f911aeb607ed0f8ffa68c0e2bc9","observation_id":"b8ce8ea2-8810-4578-ad5d-f9ba4f7f4f18","resolution":{"observed_at":"2026-08-07T04:58:48.617921Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:58:48.707660Z","title":"Affordance-based grasping and manipulation in real world applications,","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2506.09284","last_updated":"2025-08-25T19:45:29Z","snapshot_observed_at":"2026-08-08T15:02:00.662012Z","submitted_at":"2025-06-10T22:47:16Z","title":"UAD: Unsupervised Affordance Distillation for Generalization in Robotic Manipulation","version":2},"reference_index":49,"source":"pdf_text","source_observed_at":"2026-08-07T04:58:48.707660Z"},"links":{"citing_paper":"/paper/2506.09284"},"observation_digest":"sha256:c14ecea91d6d64c2b4ca47bf24485b0360b9530741c5c96eee42fceb63173096","observation_id":"b012a899-417e-481b-a26d-1a518759dfe7","resolution":{"observed_at":"2026-08-07T04:58:48.707660Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:58:48.781486Z","title":"Robotic pick-and-place of novel objects in clutter with multi-affordance grasping and cross- domain image matching,","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2506.09284","last_updated":"2025-08-25T19:45:29Z","snapshot_observed_at":"2026-08-08T15:02:00.662012Z","submitted_at":"2025-06-10T22:47:16Z","title":"UAD: Unsupervised Affordance Distillation for Generalization in Robotic Manipulation","version":2},"reference_index":50,"source":"pdf_text","source_observed_at":"2026-08-07T04:58:48.781486Z"},"links":{"citing_paper":"/paper/2506.09284"},"observation_digest":"sha256:a4cdea6ccbbd36711e167ca18b8a3ee774a35a4d5140add1834275cc07c5b82e","observation_id":"02107307-a024-4cb4-a64b-bf9a40c915a6","resolution":{"observed_at":"2026-08-07T04:58:48.781486Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:58:48.869424Z","title":"Metagrasp: Data efficient grasping by affordance interpreter network,","venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2506.09284","last_updated":"2025-08-25T19:45:29Z","snapshot_observed_at":"2026-08-08T15:02:00.662012Z","submitted_at":"2025-06-10T22:47:16Z","title":"UAD: Unsupervised Affordance Distillation for Generalization in Robotic Manipulation","version":2},"reference_index":51,"source":"pdf_text","source_observed_at":"2026-08-07T04:58:48.869424Z"},"links":{"citing_paper":"/paper/2506.09284"},"observation_digest":"sha256:a64e5ffe22b3e5ded373f6ab675d6e54c256678b3ed9a9341b03129087e0c195","observation_id":"4c791151-5b18-406d-88ae-1c10ffc337ae","resolution":{"observed_at":"2026-08-07T04:58:48.869424Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:58:48.971088Z","title":"Learning affordance space in physical world for vision-based robotic object manipulation,","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2506.09284","last_updated":"2025-08-25T19:45:29Z","snapshot_observed_at":"2026-08-08T15:02:00.662012Z","submitted_at":"2025-06-10T22:47:16Z","title":"UAD: Unsupervised Affordance Distillation for Generalization in Robotic Manipulation","version":2},"reference_index":52,"source":"pdf_text","source_observed_at":"2026-08-07T04:58:48.971088Z"},"links":{"citing_paper":"/paper/2506.09284"},"observation_digest":"sha256:df4c33e912683a7dba569252353a48c9fe915ec85f3d54ba4ef5c7a3f86e6761","observation_id":"3970c5a5-3ac6-4d1a-ab29-608314cf3452","resolution":{"observed_at":"2026-08-07T04:58:48.971088Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:58:49.052562Z","title":"Learning multi- object dense descriptor for autonomous goal-conditioned grasping,","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2506.09284","last_updated":"2025-08-25T19:45:29Z","snapshot_observed_at":"2026-08-08T15:02:00.662012Z","submitted_at":"2025-06-10T22:47:16Z","title":"UAD: Unsupervised Affordance Distillation for Generalization in Robotic Manipulation","version":2},"reference_index":53,"source":"pdf_text","source_observed_at":"2026-08-07T04:58:49.052562Z"},"links":{"citing_paper":"/paper/2506.09284"},"observation_digest":"sha256:4322961f7433f3253bda9c75643205b8e05bbfaa8cf1db4e4621c433b609d511","observation_id":"8285cf01-6602-43d6-aaaa-3c9c59c3bf2e","resolution":{"observed_at":"2026-08-07T04:58:49.052562Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:58:49.196742Z","title":"Deep affordance foresight: Planning through what can be done in the future,","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2506.09284","last_updated":"2025-08-25T19:45:29Z","snapshot_observed_at":"2026-08-08T15:02:00.662012Z","submitted_at":"2025-06-10T22:47:16Z","title":"UAD: Unsupervised Affordance Distillation for Generalization in Robotic Manipulation","version":2},"reference_index":54,"source":"pdf_text","source_observed_at":"2026-08-07T04:58:49.196742Z"},"links":{"citing_paper":"/paper/2506.09284"},"observation_digest":"sha256:56d262e058f0b0222950dbffabcf44210e05abc0624d798b44b7a6dc18e724e7","observation_id":"fd05c41d-a50c-4561-8d68-8a8efd295ad1","resolution":{"observed_at":"2026-08-07T04:58:49.196742Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:58:49.317670Z","title":"Where2act: From pixels to actions for articulated 3d objects,","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2506.09284","last_updated":"2025-08-25T19:45:29Z","snapshot_observed_at":"2026-08-08T15:02:00.662012Z","submitted_at":"2025-06-10T22:47:16Z","title":"UAD: Unsupervised Affordance Distillation for Generalization in Robotic Manipulation","version":2},"reference_index":55,"source":"pdf_text","source_observed_at":"2026-08-07T04:58:49.317670Z"},"links":{"citing_paper":"/paper/2506.09284"},"observation_digest":"sha256:48426810d02a8951d7486afe2a90cde123e45aa60fe834b663a3ffa7b1c6f149","observation_id":"d236ac2e-d78a-4397-a83d-a8604444a8e5","resolution":{"observed_at":"2026-08-07T04:58:49.317670Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2204.01691","last_updated":"2022-08-16T16:06:33Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2022-04-04T17:57:11Z","title":"Do As I Can, Not As I Say: Grounding Language in Robotic Affordances","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2204.01691","snapshot_observed_at":"2026-08-07T04:58:49.482082Z","title":"Do as i can and not as i say: Grounding language in robotic affordances,","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2506.09284","last_updated":"2025-08-25T19:45:29Z","snapshot_observed_at":"2026-08-08T15:02:00.662012Z","submitted_at":"2025-06-10T22:47:16Z","title":"UAD: Unsupervised Affordance Distillation for Generalization in Robotic Manipulation","version":2},"reference_index":56,"source":"pdf_text","source_observed_at":"2026-08-07T04:58:49.482082Z"},"links":{"cited_paper":"/paper/2204.01691","citing_paper":"/paper/2506.09284"},"observation_digest":"sha256:6a376027fe43a9b278b6d53ddd7c1e3628dd8ea4f39a128cd2d8af4e9ac958a3","observation_id":"ab0ee92c-2cc0-4092-b626-807e5d2059c9","resolution":{"observed_at":"2026-08-07T04:58:49.482082Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2210.01911","last_updated":"2023-03-08T11:00:55Z","snapshot_observed_at":"2026-08-07T01:47:59.265318Z","submitted_at":"2022-10-04T21:16:48Z","title":"Grounding Language with Visual Affordances over Unstructured Data","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2210.01911","snapshot_observed_at":"2026-08-07T04:58:49.567636Z","title":"Grounding language with visual affordances over unstructured data,","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2506.09284","last_updated":"2025-08-25T19:45:29Z","snapshot_observed_at":"2026-08-08T15:02:00.662012Z","submitted_at":"2025-06-10T22:47:16Z","title":"UAD: Unsupervised Affordance Distillation for Generalization in Robotic Manipulation","version":2},"reference_index":57,"source":"pdf_text","source_observed_at":"2026-08-07T04:58:49.567636Z"},"links":{"cited_paper":"/paper/2210.01911","citing_paper":"/paper/2506.09284"},"observation_digest":"sha256:61407b01e605af8bcc36335d55da5a57d7c5ad9c597c8444bbc914cb43afcde8","observation_id":"b1ddd6cd-2c1e-4353-8fb9-accd83001d87","resolution":{"observed_at":"2026-08-07T04:58:49.567636Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:58:49.666570Z","title":"Learning generalizable dexterous manipulation from human grasp affordance,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.09284","last_updated":"2025-08-25T19:45:29Z","snapshot_observed_at":"2026-08-08T15:02:00.662012Z","submitted_at":"2025-06-10T22:47:16Z","title":"UAD: Unsupervised Affordance Distillation for Generalization in Robotic Manipulation","version":2},"reference_index":58,"source":"pdf_text","source_observed_at":"2026-08-07T04:58:49.666570Z"},"links":{"citing_paper":"/paper/2506.09284"},"observation_digest":"sha256:428a8f93c96b558881b742e8dd3c8fc49ea30dbab452981eb4382ab9606b7fef","observation_id":"277cdb4a-ca8b-442e-b3f0-84faf4a275b9","resolution":{"observed_at":"2026-08-07T04:58:49.666570Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:58:49.775313Z","title":"Learning affordance grounding from exocentric images,","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2506.09284","last_updated":"2025-08-25T19:45:29Z","snapshot_observed_at":"2026-08-08T15:02:00.662012Z","submitted_at":"2025-06-10T22:47:16Z","title":"UAD: Unsupervised Affordance Distillation for Generalization in Robotic Manipulation","version":2},"reference_index":59,"source":"pdf_text","source_observed_at":"2026-08-07T04:58:49.775313Z"},"links":{"citing_paper":"/paper/2506.09284"},"observation_digest":"sha256:3fbd022265007960f4c139979cfdb6b614e31b727ed9c666843139ab92c1878a","observation_id":"09076003-937e-43be-9949-66c444b7c9b2","resolution":{"observed_at":"2026-08-07T04:58:49.775313Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:58:49.889545Z","title":"Locate: Localize and transfer object parts for weakly supervised affordance grounding,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.09284","last_updated":"2025-08-25T19:45:29Z","snapshot_observed_at":"2026-08-08T15:02:00.662012Z","submitted_at":"2025-06-10T22:47:16Z","title":"UAD: Unsupervised Affordance Distillation for Generalization in Robotic Manipulation","version":2},"reference_index":60,"source":"pdf_text","source_observed_at":"2026-08-07T04:58:49.889545Z"},"links":{"citing_paper":"/paper/2506.09284"},"observation_digest":"sha256:f9ae4d55fba3a42647e07a7860210df51e3a1a28c5f85410d9abc3fb4581404c","observation_id":"7606ed3e-3e38-4ba8-928e-8b8bbf197f45","resolution":{"observed_at":"2026-08-07T04:58:49.889545Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:58:50.021030Z","title":"Affordpose: A large- scale dataset of hand-object interactions with affordance-driven hand pose,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.09284","last_updated":"2025-08-25T19:45:29Z","snapshot_observed_at":"2026-08-08T15:02:00.662012Z","submitted_at":"2025-06-10T22:47:16Z","title":"UAD: Unsupervised Affordance Distillation for Generalization in Robotic Manipulation","version":2},"reference_index":61,"source":"pdf_text","source_observed_at":"2026-08-07T04:58:50.021030Z"},"links":{"citing_paper":"/paper/2506.09284"},"observation_digest":"sha256:9b6101bd9568d42f1e9908233059b76bf3df19896e00fa49ee12ff93544a4208","observation_id":"03475642-ee76-4a98-8112-518133140a07","resolution":{"observed_at":"2026-08-07T04:58:50.021030Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:58:50.183998Z","title":"3d affordancenet: A benchmark for visual object affordance understanding,","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2506.09284","last_updated":"2025-08-25T19:45:29Z","snapshot_observed_at":"2026-08-08T15:02:00.662012Z","submitted_at":"2025-06-10T22:47:16Z","title":"UAD: Unsupervised Affordance Distillation for Generalization in Robotic Manipulation","version":2},"reference_index":62,"source":"pdf_text","source_observed_at":"2026-08-07T04:58:50.183998Z"},"links":{"citing_paper":"/paper/2506.09284"},"observation_digest":"sha256:8d6956861173d52f34e310b6e6525683745e9596aad6f203c29bd1d147d15935","observation_id":"d9d4058e-15ec-4374-8b99-4ac8ca178378","resolution":{"observed_at":"2026-08-07T04:58:50.183998Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2106.14973","last_updated":"2021-06-28T20:43:35Z","snapshot_observed_at":"2026-07-06T11:23:56.887244Z","submitted_at":"2021-06-28T20:43:35Z","title":"GIFT: Generalizable Interaction-aware Functional Tool Affordances without Labels","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2106.14973","snapshot_observed_at":"2026-08-07T04:58:50.356269Z","title":"Gift: Generalizable interaction-aware functional tool affordances without labels,","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2506.09284","last_updated":"2025-08-25T19:45:29Z","snapshot_observed_at":"2026-08-08T15:02:00.662012Z","submitted_at":"2025-06-10T22:47:16Z","title":"UAD: Unsupervised Affordance Distillation for Generalization in Robotic Manipulation","version":2},"reference_index":63,"source":"pdf_text","source_observed_at":"2026-08-07T04:58:50.356269Z"},"links":{"cited_paper":"/paper/2106.14973","citing_paper":"/paper/2506.09284"},"observation_digest":"sha256:49db91053a43eacca8ef4485d67d12bf6e9d16f8b7f58af7b511a965a001b092","observation_id":"2f03fc6a-70b4-4c67-b990-e79d022a2f99","resolution":{"observed_at":"2026-08-07T04:58:50.356269Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2107.03380","last_updated":"2021-11-11T19:06:52Z","snapshot_observed_at":"2026-08-08T00:23:32.174067Z","submitted_at":"2021-07-07T17:59:07Z","title":"RRL: Resnet as representation for Reinforcement Learning","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2107.03380","snapshot_observed_at":"2026-08-07T04:58:50.507923Z","title":"Rrl: Resnet as representation for reinforce- ment learning,","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2506.09284","last_updated":"2025-08-25T19:45:29Z","snapshot_observed_at":"2026-08-08T15:02:00.662012Z","submitted_at":"2025-06-10T22:47:16Z","title":"UAD: Unsupervised Affordance Distillation for Generalization in Robotic Manipulation","version":2},"reference_index":64,"source":"pdf_text","source_observed_at":"2026-08-07T04:58:50.507923Z"},"links":{"cited_paper":"/paper/2107.03380","citing_paper":"/paper/2506.09284"},"observation_digest":"sha256:23186d930e63c868cf82eaedca04313442e0050dd0842bf40584ddfd6e78cd89","observation_id":"781c4177-2bf8-4c71-9548-8112df7bae7d","resolution":{"observed_at":"2026-08-07T04:58:50.507923Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2112.01511","last_updated":"2021-12-06T16:46:37Z","snapshot_observed_at":"2026-08-09T12:35:30.072432Z","submitted_at":"2021-12-02T18:58:09Z","title":"The Surprising Effectiveness of Representation Learning for Visual Imitation","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2112.01511","snapshot_observed_at":"2026-08-07T04:58:50.652147Z","title":"The sur- prising effectiveness of representation learning for visual imitation,","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2506.09284","last_updated":"2025-08-25T19:45:29Z","snapshot_observed_at":"2026-08-08T15:02:00.662012Z","submitted_at":"2025-06-10T22:47:16Z","title":"UAD: Unsupervised Affordance Distillation for Generalization in Robotic Manipulation","version":2},"reference_index":65,"source":"pdf_text","source_observed_at":"2026-08-07T04:58:50.652147Z"},"links":{"cited_paper":"/paper/2112.01511","citing_paper":"/paper/2506.09284"},"observation_digest":"sha256:431fef742f52cfa880a38c3a4812f856eaadc0602ff7872684694e0a55d35795","observation_id":"0ec3b6d5-215b-4888-8615-1ab1c77f80b7","resolution":{"observed_at":"2026-08-07T04:58:50.652147Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:58:50.782536Z","title":"The unsurprising effectiveness of pre-trained vision models for control,","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2506.09284","last_updated":"2025-08-25T19:45:29Z","snapshot_observed_at":"2026-08-08T15:02:00.662012Z","submitted_at":"2025-06-10T22:47:16Z","title":"UAD: Unsupervised Affordance Distillation for Generalization in Robotic Manipulation","version":2},"reference_index":66,"source":"pdf_text","source_observed_at":"2026-08-07T04:58:50.782536Z"},"links":{"citing_paper":"/paper/2506.09284"},"observation_digest":"sha256:80912efb18e99b908be2777eb0b91ec85541604d730bca7f234632a22229a1d3","observation_id":"17f43029-cc7c-4451-97c5-be6fe8275061","resolution":{"observed_at":"2026-08-07T04:58:50.782536Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2203.06173","last_updated":"2022-03-11T18:58:10Z","snapshot_observed_at":"2026-08-06T13:06:27.360959Z","submitted_at":"2022-03-11T18:58:10Z","title":"Masked Visual Pre-training for Motor Control","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2203.06173","snapshot_observed_at":"2026-08-07T04:58:50.924401Z","title":"Masked visual pre- training for motor control,","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2506.09284","last_updated":"2025-08-25T19:45:29Z","snapshot_observed_at":"2026-08-08T15:02:00.662012Z","submitted_at":"2025-06-10T22:47:16Z","title":"UAD: Unsupervised Affordance Distillation for Generalization in Robotic Manipulation","version":2},"reference_index":67,"source":"pdf_text","source_observed_at":"2026-08-07T04:58:50.924401Z"},"links":{"cited_paper":"/paper/2203.06173","citing_paper":"/paper/2506.09284"},"observation_digest":"sha256:38177164feb1a80a300540c79049be4e90ad2b43ef5a999b836f4044de2dc7ed","observation_id":"3da5337c-0210-42f4-ba89-2f6e58a19f2d","resolution":{"observed_at":"2026-08-07T04:58:50.924401Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:58:51.094252Z","title":"Real-world robot learning with masked visual pre-training,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.09284","last_updated":"2025-08-25T19:45:29Z","snapshot_observed_at":"2026-08-08T15:02:00.662012Z","submitted_at":"2025-06-10T22:47:16Z","title":"UAD: Unsupervised Affordance Distillation for Generalization in Robotic Manipulation","version":2},"reference_index":68,"source":"pdf_text","source_observed_at":"2026-08-07T04:58:51.094252Z"},"links":{"citing_paper":"/paper/2506.09284"},"observation_digest":"sha256:6fb345b7b8735286f7f9cece71eda45e292ee30c640882a36d26b9d88b4a84ee","observation_id":"2ba4dd18-59b0-432c-8c06-892b0e3577da","resolution":{"observed_at":"2026-08-07T04:58:51.094252Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2210.00030","last_updated":"2023-03-07T02:29:59Z","snapshot_observed_at":"2026-08-02T00:17:16.761436Z","submitted_at":"2022-09-30T18:14:07Z","title":"VIP: Towards Universal Visual Reward and Representation via Value-Implicit Pre-Training","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2210.00030","snapshot_observed_at":"2026-08-07T04:58:51.297606Z","title":"Vip: Towards universal visual reward and representation via value-implicit pre-training,","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2506.09284","last_updated":"2025-08-25T19:45:29Z","snapshot_observed_at":"2026-08-08T15:02:00.662012Z","submitted_at":"2025-06-10T22:47:16Z","title":"UAD: Unsupervised Affordance Distillation for Generalization in Robotic Manipulation","version":2},"reference_index":69,"source":"pdf_text","source_observed_at":"2026-08-07T04:58:51.297606Z"},"links":{"cited_paper":"/paper/2210.00030","citing_paper":"/paper/2506.09284"},"observation_digest":"sha256:6fc182258c3d9a8024dae4cc45dd66a2b1025f5553fff0957ef183c5c8e1904f","observation_id":"168fa19c-c39b-4fd3-91ba-5a5495ae9509","resolution":{"observed_at":"2026-08-07T04:58:51.297606Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:58:51.450409Z","title":"Where are we in the search for an artificial visual cortex for embodied intelligence?","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.09284","last_updated":"2025-08-25T19:45:29Z","snapshot_observed_at":"2026-08-08T15:02:00.662012Z","submitted_at":"2025-06-10T22:47:16Z","title":"UAD: Unsupervised Affordance Distillation for Generalization in Robotic Manipulation","version":2},"reference_index":70,"source":"pdf_text","source_observed_at":"2026-08-07T04:58:51.450409Z"},"links":{"citing_paper":"/paper/2506.09284"},"observation_digest":"sha256:86bcc373e27d628d3adc56c15defe027078bf2033bfab2710cc44c4809f8727d","observation_id":"7c8e226f-2a71-4d67-918c-68831c562caf","resolution":{"observed_at":"2026-08-07T04:58:51.450409Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2312.12444","last_updated":"2023-11-03T18:09:08Z","snapshot_observed_at":"2026-08-07T19:29:49.767397Z","submitted_at":"2023-11-03T18:09:08Z","title":"What Makes Pre-Trained Visual Representations Successful for Robust Manipulation?","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2312.12444","snapshot_observed_at":"2026-08-07T04:58:51.628421Z","title":"What makes pre-trained visual representations successful for robust manipulation?","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.09284","last_updated":"2025-08-25T19:45:29Z","snapshot_observed_at":"2026-08-08T15:02:00.662012Z","submitted_at":"2025-06-10T22:47:16Z","title":"UAD: Unsupervised Affordance Distillation for Generalization in Robotic Manipulation","version":2},"reference_index":71,"source":"pdf_text","source_observed_at":"2026-08-07T04:58:51.628421Z"},"links":{"cited_paper":"/paper/2312.12444","citing_paper":"/paper/2506.09284"},"observation_digest":"sha256:fd3223f6bd4fb10d6e3f51240f23b6702600ce738a046c3cdea4a81936dd6a95","observation_id":"b4b153d4-0a61-4d9e-b513-388c100d7c3f","resolution":{"observed_at":"2026-08-07T04:58:51.628421Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:58:51.721888Z","title":"Offline visual represen- tation learning for embodied navigation,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.09284","last_updated":"2025-08-25T19:45:29Z","snapshot_observed_at":"2026-08-08T15:02:00.662012Z","submitted_at":"2025-06-10T22:47:16Z","title":"UAD: Unsupervised Affordance Distillation for Generalization in Robotic Manipulation","version":2},"reference_index":72,"source":"pdf_text","source_observed_at":"2026-08-07T04:58:51.721888Z"},"links":{"citing_paper":"/paper/2506.09284"},"observation_digest":"sha256:571be74646cd13205d8d76ba115c9969b1464a2505c4c4c282a504f0c7b3a256","observation_id":"f34737fc-71d5-4eb4-af7c-62dd024ddbb8","resolution":{"observed_at":"2026-08-07T04:58:51.721888Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2203.12601","last_updated":"2022-11-18T05:57:09Z","snapshot_observed_at":"2026-08-02T11:48:59.131827Z","submitted_at":"2022-03-23T17:55:09Z","title":"R3M: A Universal Visual Representation for Robot Manipulation","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2203.12601","snapshot_observed_at":"2026-08-07T04:58:51.906420Z","title":"R3m: A universal visual representation for robot manipulation,","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2506.09284","last_updated":"2025-08-25T19:45:29Z","snapshot_observed_at":"2026-08-08T15:02:00.662012Z","submitted_at":"2025-06-10T22:47:16Z","title":"UAD: Unsupervised Affordance Distillation for Generalization in Robotic Manipulation","version":2},"reference_index":73,"source":"pdf_text","source_observed_at":"2026-08-07T04:58:51.906420Z"},"links":{"cited_paper":"/paper/2203.12601","citing_paper":"/paper/2506.09284"},"observation_digest":"sha256:192d3219ead7ac95e7c0a9dcb2203f4a3fd07796c2eff15a79dc4fd154fe0406","observation_id":"960851e6-defb-451b-bcef-81884104afa2","resolution":{"observed_at":"2026-08-07T04:58:51.906420Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2302.12766","last_updated":"2023-02-24T17:29:31Z","snapshot_observed_at":"2026-08-09T00:25:43.898202Z","submitted_at":"2023-02-24T17:29:31Z","title":"Language-Driven Representation Learning for Robotics","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2302.12766","snapshot_observed_at":"2026-08-07T04:58:52.096173Z","title":"Language-driven representation learning for robotics,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.09284","last_updated":"2025-08-25T19:45:29Z","snapshot_observed_at":"2026-08-08T15:02:00.662012Z","submitted_at":"2025-06-10T22:47:16Z","title":"UAD: Unsupervised Affordance Distillation for Generalization in Robotic Manipulation","version":2},"reference_index":74,"source":"pdf_text","source_observed_at":"2026-08-07T04:58:52.096173Z"},"links":{"cited_paper":"/paper/2302.12766","citing_paper":"/paper/2506.09284"},"observation_digest":"sha256:024f80da61045786bacd05a0dee21e06bae339a560dc2ec7c7db9f52ec6abf62","observation_id":"1eba31b4-7702-4fa7-92a2-68d39581b209","resolution":{"observed_at":"2026-08-07T04:58:52.096173Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:58:52.271406Z","title":"Liv: Language-image representations and rewards for robotic control,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.09284","last_updated":"2025-08-25T19:45:29Z","snapshot_observed_at":"2026-08-08T15:02:00.662012Z","submitted_at":"2025-06-10T22:47:16Z","title":"UAD: Unsupervised Affordance Distillation for Generalization in Robotic Manipulation","version":2},"reference_index":75,"source":"pdf_text","source_observed_at":"2026-08-07T04:58:52.271406Z"},"links":{"citing_paper":"/paper/2506.09284"},"observation_digest":"sha256:0db23ce732f2538275e02520fe238cb9f9d98c132f16bb9c88bdda379ac6a01e","observation_id":"0035884c-289e-4e54-b2e5-46a31acf3de3","resolution":{"observed_at":"2026-08-07T04:58:52.271406Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:58:52.402855Z","title":"Simple but effective: Clip embeddings for embodied ai,","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2506.09284","last_updated":"2025-08-25T19:45:29Z","snapshot_observed_at":"2026-08-08T15:02:00.662012Z","submitted_at":"2025-06-10T22:47:16Z","title":"UAD: Unsupervised Affordance Distillation for Generalization in Robotic Manipulation","version":2},"reference_index":76,"source":"pdf_text","source_observed_at":"2026-08-07T04:58:52.402855Z"},"links":{"citing_paper":"/paper/2506.09284"},"observation_digest":"sha256:e9d59178eae23b97e10fcec467f568b4f0a78f4e41455f0f99218c7f911b1f63","observation_id":"1dffb014-20d6-4ff4-b171-f53a5e01ad6c","resolution":{"observed_at":"2026-08-07T04:58:52.402855Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:59:04.084624Z","title":"Can foundation models perform zero-shot task specification for robot manipulation?","venue":null,"work_id":"d551d49f-9d0d-4415-816a-a718dc337abd","year":2022},"citing_paper":{"arxiv_id":"2506.09284","last_updated":"2025-08-25T19:45:29Z","snapshot_observed_at":"2026-08-08T15:02:00.662012Z","submitted_at":"2025-06-10T22:47:16Z","title":"UAD: Unsupervised Affordance Distillation for Generalization in Robotic Manipulation","version":2},"reference_index":77,"source":"pdf_text","source_observed_at":"2026-08-07T04:58:52.520738Z"},"links":{"citing_paper":"/paper/2506.09284"},"observation_digest":"sha256:70fa4d17074c99bce1ef6be06aecc529b8d514a37a55df6fdf68bd781c0d9dc0","observation_id":"b9d61ca8-86ce-4473-82bf-2a4c10d74ec2","resolution":{"observed_at":"2026-08-07T04:59:04.169964Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:59:03.926476Z","title":"Cliport: What and where pathways for robotic manipulation,","venue":null,"work_id":"5f47c711-4a0f-4b04-9b48-47d145870977","year":2022},"citing_paper":{"arxiv_id":"2506.09284","last_updated":"2025-08-25T19:45:29Z","snapshot_observed_at":"2026-08-08T15:02:00.662012Z","submitted_at":"2025-06-10T22:47:16Z","title":"UAD: Unsupervised Affordance Distillation for Generalization in Robotic Manipulation","version":2},"reference_index":78,"source":"pdf_text","source_observed_at":"2026-08-07T04:58:52.576876Z"},"links":{"citing_paper":"/paper/2506.09284"},"observation_digest":"sha256:c66cab9c577cb55577d18bcc8d7a8f1c67d7121a2f8139cd1c530ce5e799cbb7","observation_id":"55851907-02d3-4937-9092-64624485edbd","resolution":{"observed_at":"2026-08-07T04:59:04.002602Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:59:03.777545Z","title":"Spawnnet: Learning generalizable visuomotor skills from pre-trained network,","venue":null,"work_id":"7a240040-045e-4d92-a40d-20e65f34c7bd","year":2024},"citing_paper":{"arxiv_id":"2506.09284","last_updated":"2025-08-25T19:45:29Z","snapshot_observed_at":"2026-08-08T15:02:00.662012Z","submitted_at":"2025-06-10T22:47:16Z","title":"UAD: Unsupervised Affordance Distillation for Generalization in Robotic Manipulation","version":2},"reference_index":79,"source":"pdf_text","source_observed_at":"2026-08-07T04:58:52.659184Z"},"links":{"citing_paper":"/paper/2506.09284"},"observation_digest":"sha256:7ec2871175b7773c9d2101aa65b4c226628beff548fd56a3e03206196d840ce8","observation_id":"e918e6f7-52a9-4835-96fd-c42b9129e3dd","resolution":{"observed_at":"2026-08-07T04:59:03.854511Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:59:03.644375Z","title":"GenDP: 3d semantic fields for category-level generalizable diffusion policy,","venue":null,"work_id":"d0702118-e6bc-4d71-8743-ece0f04063a9","year":2024},"citing_paper":{"arxiv_id":"2506.09284","last_updated":"2025-08-25T19:45:29Z","snapshot_observed_at":"2026-08-08T15:02:00.662012Z","submitted_at":"2025-06-10T22:47:16Z","title":"UAD: Unsupervised Affordance Distillation for Generalization in Robotic Manipulation","version":2},"reference_index":80,"source":"pdf_text","source_observed_at":"2026-08-07T04:58:52.744717Z"},"links":{"citing_paper":"/paper/2506.09284"},"observation_digest":"sha256:23bf33120235bd83c11b43452afd12c1738ccd93a9a9781a4bbc735062efff24","observation_id":"a52aad4e-5e76-44ac-a4d1-c34c65cb6eb8","resolution":{"observed_at":"2026-08-07T04:59:03.714794Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2410.22325","last_updated":"2024-10-30T03:33:08Z","snapshot_observed_at":"2026-07-06T19:41:46.397542Z","submitted_at":"2024-10-29T17:58:13Z","title":"Robots Pre-train Robots: Manipulation-Centric Robotic Representation from Large-Scale Robot Datasets","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2410.22325","snapshot_observed_at":"2026-08-07T04:58:52.920607Z","title":"Robots pre-train robots: Manipulation-centric robotic representation from large-scale robot datasets,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.09284","last_updated":"2025-08-25T19:45:29Z","snapshot_observed_at":"2026-08-08T15:02:00.662012Z","submitted_at":"2025-06-10T22:47:16Z","title":"UAD: Unsupervised Affordance Distillation for Generalization in Robotic Manipulation","version":2},"reference_index":81,"source":"pdf_text","source_observed_at":"2026-08-07T04:58:52.920607Z"},"links":{"cited_paper":"/paper/2410.22325","citing_paper":"/paper/2506.09284"},"observation_digest":"sha256:52ad302346203d0b313b68ab08d4de9f300fc23e9f564f81a1cc529b510d4706","observation_id":"f967932b-d908-4fc6-8bc9-2335c91f3037","resolution":{"observed_at":"2026-08-07T04:58:52.920607Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:58:53.028914Z","title":"Otter: A vision-language-action model with text-aware visual feature extraction,","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2506.09284","last_updated":"2025-08-25T19:45:29Z","snapshot_observed_at":"2026-08-08T15:02:00.662012Z","submitted_at":"2025-06-10T22:47:16Z","title":"UAD: Unsupervised Affordance Distillation for Generalization in Robotic Manipulation","version":2},"reference_index":82,"source":"pdf_text","source_observed_at":"2026-08-07T04:58:53.028914Z"},"links":{"citing_paper":"/paper/2506.09284"},"observation_digest":"sha256:2e34583b94df2c34c3aa9b31f30f2d50fa2b6f681368dc6e9f83406683d04289","observation_id":"1a770ebd-471e-48d7-bb2c-63f0d92aafb2","resolution":{"observed_at":"2026-08-07T04:58:53.028914Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:59:03.484015Z","title":"Eyes wide shut? exploring the visual shortcomings of multimodal llms,","venue":null,"work_id":"2a9ce6d0-3fff-438f-bf3d-e82a329addbc","year":2024},"citing_paper":{"arxiv_id":"2506.09284","last_updated":"2025-08-25T19:45:29Z","snapshot_observed_at":"2026-08-08T15:02:00.662012Z","submitted_at":"2025-06-10T22:47:16Z","title":"UAD: Unsupervised Affordance Distillation for Generalization in Robotic Manipulation","version":2},"reference_index":83,"source":"pdf_text","source_observed_at":"2026-08-07T04:58:53.116398Z"},"links":{"citing_paper":"/paper/2506.09284"},"observation_digest":"sha256:5114e4e890eed3a091ea49e6008f8fcfc9e176e1c5904787ad8064d779708134","observation_id":"9b015a26-9eab-4b09-ab92-d10730fb916a","resolution":{"observed_at":"2026-08-07T04:59:03.552760Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:59:03.333109Z","title":"Winoground: Probing vision and language models for visio-linguistic compositionality,","venue":null,"work_id":"2870ae79-2337-438d-b079-2e9ee789b3cb","year":2022},"citing_paper":{"arxiv_id":"2506.09284","last_updated":"2025-08-25T19:45:29Z","snapshot_observed_at":"2026-08-08T15:02:00.662012Z","submitted_at":"2025-06-10T22:47:16Z","title":"UAD: Unsupervised Affordance Distillation for Generalization in Robotic Manipulation","version":2},"reference_index":84,"source":"pdf_text","source_observed_at":"2026-08-07T04:58:53.185987Z"},"links":{"citing_paper":"/paper/2506.09284"},"observation_digest":"sha256:5070f5905eb7b573b88e911df3e0e8f4c6c55f29b375ccafe3472105ed34b813","observation_id":"6097c010-d01f-4301-bab4-b3ae464669e7","resolution":{"observed_at":"2026-08-07T04:59:03.401089Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:59:03.184505Z","title":"When and why vision-language models behave like bags-of-words, and what to do about it?","venue":null,"work_id":"7ec426ac-07ec-4581-b9a6-b165f7fcb914","year":2023},"citing_paper":{"arxiv_id":"2506.09284","last_updated":"2025-08-25T19:45:29Z","snapshot_observed_at":"2026-08-08T15:02:00.662012Z","submitted_at":"2025-06-10T22:47:16Z","title":"UAD: Unsupervised Affordance Distillation for Generalization in Robotic Manipulation","version":2},"reference_index":85,"source":"pdf_text","source_observed_at":"2026-08-07T04:58:53.298491Z"},"links":{"citing_paper":"/paper/2506.09284"},"observation_digest":"sha256:18a7649ac3b143797fda4f552ec7ed9e4a6e614462a08a3a0ff51fdbd424a15c","observation_id":"4fc9eb35-f6f9-44eb-928d-53a2da57c95b","resolution":{"observed_at":"2026-08-07T04:59:03.255481Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:59:03.068641Z","title":"Sugarcrepe: Fixing hackable benchmarks for vision-language com- positionality,","venue":null,"work_id":"560b5315-65cf-4910-92d5-99d20cdb3195","year":2024},"citing_paper":{"arxiv_id":"2506.09284","last_updated":"2025-08-25T19:45:29Z","snapshot_observed_at":"2026-08-08T15:02:00.662012Z","submitted_at":"2025-06-10T22:47:16Z","title":"UAD: Unsupervised Affordance Distillation for Generalization in Robotic Manipulation","version":2},"reference_index":86,"source":"pdf_text","source_observed_at":"2026-08-07T04:58:53.393018Z"},"links":{"citing_paper":"/paper/2506.09284"},"observation_digest":"sha256:0acd2439b14a6733a49b92acc7ab2fc2e95e96dba3fc5b66e466e98654723bac","observation_id":"6b3b1b70-27e1-4782-ad42-2c332e9f47d9","resolution":{"observed_at":"2026-08-07T04:59:03.113881Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2312.08782","last_updated":"2024-10-01T08:54:53Z","snapshot_observed_at":"2026-07-06T17:01:35.415575Z","submitted_at":"2023-12-14T10:02:55Z","title":"Toward General-Purpose Robots via Foundation Models: A Survey and Meta-Analysis","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2312.08782","snapshot_observed_at":"2026-08-07T04:58:53.446033Z","title":"Toward general-purpose robots via foundation models: A survey and meta-analysis,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.09284","last_updated":"2025-08-25T19:45:29Z","snapshot_observed_at":"2026-08-08T15:02:00.662012Z","submitted_at":"2025-06-10T22:47:16Z","title":"UAD: Unsupervised Affordance Distillation for Generalization in Robotic Manipulation","version":2},"reference_index":87,"source":"pdf_text","source_observed_at":"2026-08-07T04:58:53.446033Z"},"links":{"cited_paper":"/paper/2312.08782","citing_paper":"/paper/2506.09284"},"observation_digest":"sha256:8e40ad0ee7f6adfee0b4d0c0a0bb5abfdbe224472f99e4e1c510f97aedf20fa1","observation_id":"711095f9-707b-4ef9-a73c-36d951d0a4f5","resolution":{"observed_at":"2026-08-07T04:58:53.446033Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2312.07843","last_updated":"2023-12-13T02:20:42Z","snapshot_observed_at":"2026-07-06T17:00:53.532910Z","submitted_at":"2023-12-13T02:20:42Z","title":"Foundation Models in Robotics: Applications, Challenges, and the Future","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2312.07843","snapshot_observed_at":"2026-08-07T04:58:53.510632Z","title":"Foundation models in robotics: Applications, challenges, and the future,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.09284","last_updated":"2025-08-25T19:45:29Z","snapshot_observed_at":"2026-08-08T15:02:00.662012Z","submitted_at":"2025-06-10T22:47:16Z","title":"UAD: Unsupervised Affordance Distillation for Generalization in Robotic Manipulation","version":2},"reference_index":88,"source":"pdf_text","source_observed_at":"2026-08-07T04:58:53.510632Z"},"links":{"cited_paper":"/paper/2312.07843","citing_paper":"/paper/2506.09284"},"observation_digest":"sha256:efce5f6d54aa3a108ff6de72b7093868e59f5d7d2e626bf0479c86a70c643bec","observation_id":"5c2bc97e-5099-4d5f-a048-f7d04c57ed39","resolution":{"observed_at":"2026-08-07T04:58:53.510632Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2402.05741","last_updated":"2024-10-23T03:39:00Z","snapshot_observed_at":"2026-08-09T16:37:33.931118Z","submitted_at":"2024-02-08T15:19:50Z","title":"Real-World Robot Applications of Foundation Models: A Review","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.05741","snapshot_observed_at":"2026-08-07T04:58:53.560629Z","title":"Real-world robot applications of foundation models: A review,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.09284","last_updated":"2025-08-25T19:45:29Z","snapshot_observed_at":"2026-08-08T15:02:00.662012Z","submitted_at":"2025-06-10T22:47:16Z","title":"UAD: Unsupervised Affordance Distillation for Generalization in Robotic Manipulation","version":2},"reference_index":89,"source":"pdf_text","source_observed_at":"2026-08-07T04:58:53.560629Z"},"links":{"cited_paper":"/paper/2402.05741","citing_paper":"/paper/2506.09284"},"observation_digest":"sha256:1c1c4130681631d9df01ca47025cae1bbfee001eba97a6ea619b9827f2c7315e","observation_id":"76fa5d92-a3ce-4484-b69b-8f9b89d44e92","resolution":{"observed_at":"2026-08-07T04:58:53.560629Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2303.04129","last_updated":"2023-03-07T18:44:07Z","snapshot_observed_at":"2026-08-03T19:24:56.017408Z","submitted_at":"2023-03-07T18:44:07Z","title":"Foundation Models for Decision Making: Problems, Methods, and Opportunities","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2303.04129","snapshot_observed_at":"2026-08-07T04:58:53.629901Z","title":"Foundation models for decision making: Problems, methods, and opportunities,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.09284","last_updated":"2025-08-25T19:45:29Z","snapshot_observed_at":"2026-08-08T15:02:00.662012Z","submitted_at":"2025-06-10T22:47:16Z","title":"UAD: Unsupervised Affordance Distillation for Generalization in Robotic Manipulation","version":2},"reference_index":90,"source":"pdf_text","source_observed_at":"2026-08-07T04:58:53.629901Z"},"links":{"cited_paper":"/paper/2303.04129","citing_paper":"/paper/2506.09284"},"observation_digest":"sha256:cb211a79288d738bf207691f71f9d95b76c2b9144e5e07c3b092224647441bc4","observation_id":"e93e8ece-734e-48d8-ac24-14f4972fb4fd","resolution":{"observed_at":"2026-08-07T04:58:53.629901Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2403.08248","last_updated":"2024-03-13T05:03:58Z","snapshot_observed_at":"2026-08-09T01:27:41.616779Z","submitted_at":"2024-03-13T05:03:58Z","title":"CoPa: General Robotic Manipulation through Spatial Constraints of Parts with Foundation Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2403.08248","snapshot_observed_at":"2026-08-07T04:58:53.681208Z","title":"Copa: General robotic manipulation through spatial constraints of parts with foun- dation models,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.09284","last_updated":"2025-08-25T19:45:29Z","snapshot_observed_at":"2026-08-08T15:02:00.662012Z","submitted_at":"2025-06-10T22:47:16Z","title":"UAD: Unsupervised Affordance Distillation for Generalization in Robotic Manipulation","version":2},"reference_index":91,"source":"pdf_text","source_observed_at":"2026-08-07T04:58:53.681208Z"},"links":{"cited_paper":"/paper/2403.08248","citing_paper":"/paper/2506.09284"},"observation_digest":"sha256:14450d503cbe56d1d9a047fb6f498731585d2732f54440063eb0de6ef08ac312","observation_id":"05e3e450-66f9-4da2-bb16-59a5c5e6eafd","resolution":{"observed_at":"2026-08-07T04:58:53.681208Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2403.03174","last_updated":"2024-09-04T01:18:13Z","snapshot_observed_at":"2026-08-08T15:04:46.831297Z","submitted_at":"2024-03-05T18:08:45Z","title":"MOKA: Open-World Robotic Manipulation through Mark-Based Visual Prompting","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2403.03174","snapshot_observed_at":"2026-08-07T04:58:53.781859Z","title":"Moka: Open-vocabulary robotic manipulation through mark-based visual prompting,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.09284","last_updated":"2025-08-25T19:45:29Z","snapshot_observed_at":"2026-08-08T15:02:00.662012Z","submitted_at":"2025-06-10T22:47:16Z","title":"UAD: Unsupervised Affordance Distillation for Generalization in Robotic Manipulation","version":2},"reference_index":92,"source":"pdf_text","source_observed_at":"2026-08-07T04:58:53.781859Z"},"links":{"cited_paper":"/paper/2403.03174","citing_paper":"/paper/2506.09284"},"observation_digest":"sha256:102f0968246b8783ab57f74a14fc1faac3df39fe3bb8f93419bc69ef2d084f53","observation_id":"9650ecbe-c9d9-45a7-b74f-d7da9e6b17ae","resolution":{"observed_at":"2026-08-07T04:58:53.781859Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2402.07872","last_updated":"2024-02-12T18:33:47Z","snapshot_observed_at":"2026-08-02T06:03:03.152035Z","submitted_at":"2024-02-12T18:33:47Z","title":"PIVOT: Iterative Visual Prompting Elicits Actionable Knowledge for VLMs","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.07872","snapshot_observed_at":"2026-08-07T04:58:53.856037Z","title":"Pivot: Iterative visual prompting elicits actionable knowledge for vlms,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.09284","last_updated":"2025-08-25T19:45:29Z","snapshot_observed_at":"2026-08-08T15:02:00.662012Z","submitted_at":"2025-06-10T22:47:16Z","title":"UAD: Unsupervised Affordance Distillation for Generalization in Robotic Manipulation","version":2},"reference_index":93,"source":"pdf_text","source_observed_at":"2026-08-07T04:58:53.856037Z"},"links":{"cited_paper":"/paper/2402.07872","citing_paper":"/paper/2506.09284"},"observation_digest":"sha256:26129cfd754a70a28e70c935c27bc16b9ad7c56c647e510fe1943dfa8502a54b","observation_id":"e5c1427f-7675-42e3-8e7c-fe077f9071ec","resolution":{"observed_at":"2026-08-07T04:58:53.856037Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2311.17842","last_updated":"2023-12-24T03:48:40Z","snapshot_observed_at":"2026-08-07T02:37:30.672574Z","submitted_at":"2023-11-29T17:46:25Z","title":"Look Before You Leap: Unveiling the Power of GPT-4V in Robotic Vision-Language Planning","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2311.17842","snapshot_observed_at":"2026-08-07T04:58:53.946964Z","title":"Look before you leap: Unveiling the power of gpt-4v in robotic vision-language planning,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.09284","last_updated":"2025-08-25T19:45:29Z","snapshot_observed_at":"2026-08-08T15:02:00.662012Z","submitted_at":"2025-06-10T22:47:16Z","title":"UAD: Unsupervised Affordance Distillation for Generalization in Robotic Manipulation","version":2},"reference_index":94,"source":"pdf_text","source_observed_at":"2026-08-07T04:58:53.946964Z"},"links":{"cited_paper":"/paper/2311.17842","citing_paper":"/paper/2506.09284"},"observation_digest":"sha256:e7fdc056348288cf23cece05a5606867bb6b680111c92bd67d5b91224182725f","observation_id":"f7a13579-681a-48dd-9bce-fc3b01b1feea","resolution":{"observed_at":"2026-08-07T04:58:53.946964Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2310.10625","last_updated":"2023-10-16T17:48:45Z","snapshot_observed_at":"2026-08-09T12:57:58.196865Z","submitted_at":"2023-10-16T17:48:45Z","title":"Video Language Planning","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2310.10625","snapshot_observed_at":"2026-08-07T04:58:54.032686Z","title":"Video language planning,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.09284","last_updated":"2025-08-25T19:45:29Z","snapshot_observed_at":"2026-08-08T15:02:00.662012Z","submitted_at":"2025-06-10T22:47:16Z","title":"UAD: Unsupervised Affordance Distillation for Generalization in Robotic Manipulation","version":2},"reference_index":95,"source":"pdf_text","source_observed_at":"2026-08-07T04:58:54.032686Z"},"links":{"cited_paper":"/paper/2310.10625","citing_paper":"/paper/2506.09284"},"observation_digest":"sha256:f759a424c8761c6c3fbf9b495d525c183547632b4919290faf2350ad209ee49e","observation_id":"212b8b0c-8cee-4d8d-9395-ed48d4d60a43","resolution":{"observed_at":"2026-08-07T04:58:54.032686Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:58:54.106707Z","title":"3d-llm: Injecting the 3d world into large language models,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.09284","last_updated":"2025-08-25T19:45:29Z","snapshot_observed_at":"2026-08-08T15:02:00.662012Z","submitted_at":"2025-06-10T22:47:16Z","title":"UAD: Unsupervised Affordance Distillation for Generalization in Robotic Manipulation","version":2},"reference_index":96,"source":"pdf_text","source_observed_at":"2026-08-07T04:58:54.106707Z"},"links":{"citing_paper":"/paper/2506.09284"},"observation_digest":"sha256:4038e33d62ddbc2162185ae371eaf9d45663b7dd4f63e8e7a5c973cb064f78a0","observation_id":"bf6f62ab-99f5-4a2a-b8b4-01ab94f7d42b","resolution":{"observed_at":"2026-08-07T04:58:54.106707Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:58:54.198673Z","title":"Spatialvlm: Endowing vision-language models with spatial reasoning capabilities,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.09284","last_updated":"2025-08-25T19:45:29Z","snapshot_observed_at":"2026-08-08T15:02:00.662012Z","submitted_at":"2025-06-10T22:47:16Z","title":"UAD: Unsupervised Affordance Distillation for Generalization in Robotic Manipulation","version":2},"reference_index":97,"source":"pdf_text","source_observed_at":"2026-08-07T04:58:54.198673Z"},"links":{"citing_paper":"/paper/2506.09284"},"observation_digest":"sha256:26aa4ec0203be8334b0f83b227699d52ccf08971640bd9c46cd9ccede8967f6a","observation_id":"e1a5d62c-6a73-4296-9ebb-969f44d1c380","resolution":{"observed_at":"2026-08-07T04:58:54.198673Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2307.05973","last_updated":"2023-11-02T06:53:37Z","snapshot_observed_at":"2026-08-05T01:03:23.456778Z","submitted_at":"2023-07-12T07:40:48Z","title":"VoxPoser: Composable 3D Value Maps for Robotic Manipulation with Language Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2307.05973","snapshot_observed_at":"2026-08-07T04:58:54.287250Z","title":"V oxposer: Composable 3d value maps for robotic manipulation with language models,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.09284","last_updated":"2025-08-25T19:45:29Z","snapshot_observed_at":"2026-08-08T15:02:00.662012Z","submitted_at":"2025-06-10T22:47:16Z","title":"UAD: Unsupervised Affordance Distillation for Generalization in Robotic Manipulation","version":2},"reference_index":98,"source":"pdf_text","source_observed_at":"2026-08-07T04:58:54.287250Z"},"links":{"cited_paper":"/paper/2307.05973","citing_paper":"/paper/2506.09284"},"observation_digest":"sha256:0d8a6a1866ef23836e0d97995ce7483681a0a9139c9d2b178a2999d9e578b86c","observation_id":"93201b58-411a-462f-a005-259eef537302","resolution":{"observed_at":"2026-08-07T04:58:54.287250Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2307.15818","last_updated":"2023-07-28T21:18:02Z","snapshot_observed_at":"2026-08-02T16:17:50.621617Z","submitted_at":"2023-07-28T21:18:02Z","title":"RT-2: Vision-Language-Action Models Transfer Web Knowledge to Robotic Control","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2307.15818","snapshot_observed_at":"2026-08-07T04:58:54.362866Z","title":"Rt-2: Vision- language-action models transfer web knowledge to robotic control,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.09284","last_updated":"2025-08-25T19:45:29Z","snapshot_observed_at":"2026-08-08T15:02:00.662012Z","submitted_at":"2025-06-10T22:47:16Z","title":"UAD: Unsupervised Affordance Distillation for Generalization in Robotic Manipulation","version":2},"reference_index":99,"source":"pdf_text","source_observed_at":"2026-08-07T04:58:54.362866Z"},"links":{"cited_paper":"/paper/2307.15818","citing_paper":"/paper/2506.09284"},"observation_digest":"sha256:621d926eeba6a413ceb7c9341b32f13297e192c71cc936818942340bf2cf1809","observation_id":"fc97f1a8-e40b-48ed-a702-05e50757c3c4","resolution":{"observed_at":"2026-08-07T04:58:54.362866Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2309.02561","last_updated":"2024-03-03T08:12:36Z","snapshot_observed_at":"2026-07-06T16:14:56.479402Z","submitted_at":"2023-09-05T20:21:03Z","title":"Physically Grounded Vision-Language Models for Robotic Manipulation","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2309.02561","snapshot_observed_at":"2026-08-07T04:58:54.442710Z","title":"Physically grounded vision-language models for robotic manipulation,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.09284","last_updated":"2025-08-25T19:45:29Z","snapshot_observed_at":"2026-08-08T15:02:00.662012Z","submitted_at":"2025-06-10T22:47:16Z","title":"UAD: Unsupervised Affordance Distillation for Generalization in Robotic Manipulation","version":2},"reference_index":100,"source":"pdf_text","source_observed_at":"2026-08-07T04:58:54.442710Z"},"links":{"cited_paper":"/paper/2309.02561","citing_paper":"/paper/2506.09284"},"observation_digest":"sha256:f3efd58afa03a16a5e1960d883a641c6cdf1865acc79b4a9b941ae1bddf8e084","observation_id":"c35d9411-e81c-49cf-b1e6-df87bda53714","resolution":{"observed_at":"2026-08-07T04:58:54.442710Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"paper":{"arxiv_id":"2506.09284","last_updated":"2025-08-25T19:45:29Z","latest_version":2,"primary_category":"cs.RO","snapshot_observed_at":"2026-08-08T15:02:00.662012Z","submitted_at":"2025-06-10T22:47:16Z","title":"UAD: Unsupervised Affordance Distillation for Generalization in Robotic Manipulation"},"reference_resolution":{"displayed":100,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":91,"verified_exact":1,"verified_fuzzy":8},"total_outbound_references":135},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"thesis":"As of 10 August 2026, this Paper Citation Record lists 100 of 135 outbound references and 7 inbound Pith citation observations for arXiv:2506.09284."}