{"as_of":"2026-08-12T21:41:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:10e298b6ae9881c97d90bbd4e1c8bde4a4525f77a9d23909853c315492b53df8","coverage":[{"denominator":68,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":68,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-12T06:02:52.770915Z","state":"measured"},{"denominator":71,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":71,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-12T06:34:41.77262+00:00","state":"measured"},{"denominator":3,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":3,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-12T04:22:04.006460Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"arxiv_reference","source_observed_at":"2026-05-11T16:06:35.571590Z","state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2411.19626","last_updated":"2025-03-29T03:46:58Z","snapshot_observed_at":"2026-08-12T05:57:13.467211Z","submitted_at":"2024-11-29T11:23:15Z","title":"GREAT: Geometry-Intention Collaborative Inference for Open-Vocabulary 3D Object Affordance Grounding","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2411.19626","snapshot_observed_at":"2026-08-12T04:22:04.006460Z","title":"Great: Geometry-intention collab- orative inference for open-vocabulary 3d object affordance grounding","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2412.01550","last_updated":"2025-03-21T04:31:01Z","snapshot_observed_at":"2026-08-12T17:07:47.978332Z","submitted_at":"2024-12-02T14:37:57Z","title":"SeqAfford: Sequential 3D Affordance Reasoning via Multimodal Large Language Model","version":3},"reference_index":38,"source":"pdf_text","source_observed_at":"2026-08-12T04:22:04.006460Z"},"links":{"cited_paper":"/paper/2411.19626","citing_paper":"/paper/2412.01550"},"observation_digest":"sha256:f5208ae0ccad4721568c2545af7b3808104be102b7e1bb73d2b8a5b6c1334722","observation_id":"47ba5652-44dd-42a8-a062-adf68c30b165","resolution":{"observed_at":"2026-08-12T04:22:04.006460Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2411.19626","last_updated":"2025-03-29T03:46:58Z","snapshot_observed_at":"2026-08-12T05:57:13.467211Z","submitted_at":"2024-11-29T11:23:15Z","title":"GREAT: Geometry-Intention Collaborative Inference for Open-Vocabulary 3D Object Affordance Grounding","version":2},"cited_work":{"arxiv_id":"2411.19626","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2411.19626","snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"arXiv preprint arXiv:2411.19626 (2024)","venue":null,"work_id":"e1a17fad-7245-4d5c-a2d9-4c131c3f9302","year":2024},"citing_paper":{"arxiv_id":"2605.00663","last_updated":"2026-05-08T08:29:03Z","snapshot_observed_at":"2026-08-02T07:41:35.517099Z","submitted_at":"2026-05-01T13:45:16Z","title":"Affordance Agent Harness: Verification-Gated Skill Orchestration","version":1},"reference_index":58,"source":"pdf_text","source_observed_at":"2026-05-09T18:40:53.380512Z"},"links":{"cited_paper":"/paper/2411.19626","citing_paper":"/paper/2605.00663"},"observation_digest":"sha256:840e27ff8d4338d6758b1121dacc05c748b6fd60aad5aad8fd8a7d6bc391fb5c","observation_id":"37b9a7fc-b545-454c-b580-d461ed16993c","resolution":{"observed_at":"2026-05-11T16:06:35.648383Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2411.19626","last_updated":"2025-03-29T03:46:58Z","snapshot_observed_at":"2026-08-12T05:57:13.467211Z","submitted_at":"2024-11-29T11:23:15Z","title":"GREAT: Geometry-Intention Collaborative Inference for Open-Vocabulary 3D Object Affordance Grounding","version":2},"cited_work":{"arxiv_id":"2411.19626","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2411.19626","snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"arXiv preprint arXiv:2411.19626 (2024)","venue":null,"work_id":"e1a17fad-7245-4d5c-a2d9-4c131c3f9302","year":2024},"citing_paper":{"arxiv_id":"2605.00663","last_updated":"2026-05-08T08:29:03Z","snapshot_observed_at":"2026-08-02T07:41:35.517099Z","submitted_at":"2026-05-01T13:45:16Z","title":"Affordance Agent Harness: Verification-Gated Skill Orchestration","version":2},"reference_index":58,"source":"pdf_text","source_observed_at":"2026-05-11T01:55:07.248106Z"},"links":{"cited_paper":"/paper/2411.19626","citing_paper":"/paper/2605.00663"},"observation_digest":"sha256:c08a00c40c10cd6f2c738bffa2f9e4adbb2bc8fa8be36da6fd769328a6944552","observation_id":"59a5aa39-9181-4f66-be37-70031da58647","resolution":{"observed_at":"2026-05-11T04:10:55.953383Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}}],"links":{"evidence":"/evidence","html":"/paper/2411.19626/citation-record","integrity":"/paper/2411.19626/integrity","json":"/paper/2411.19626/citation-record.json","paper":"/paper/2411.19626"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T06:02:53.422521Z","title":"Cross- modal learning for image-guided point cloud shape comple- tion","venue":null,"work_id":"d882476e-57c7-4b29-a49f-65cb92365f46","year":null},"citing_paper":{"arxiv_id":"2411.19626","last_updated":"2025-03-29T03:46:58Z","snapshot_observed_at":"2026-08-12T05:57:13.467211Z","submitted_at":"2024-11-29T11:23:15Z","title":"GREAT: Geometry-Intention Collaborative Inference for Open-Vocabulary 3D Object Affordance Grounding","version":2},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-12T06:02:52.550568Z"},"links":{"citing_paper":"/paper/2411.19626"},"observation_digest":"sha256:7dd6f0d1175dde2da8f1cfe0e0817938d225ce88ee065aa6747be2af5efae1f2","observation_id":"109bb514-ed7b-4d3d-a898-c58c27f03cd4","resolution":{"observed_at":"2026-08-12T06:02:53.426342Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2202.13519","last_updated":"2022-02-28T02:58:36Z","snapshot_observed_at":"2026-08-08T14:50:58.317346Z","submitted_at":"2022-02-28T02:58:36Z","title":"PartAfford: Part-level Affordance Discovery from 3D Objects","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2202.13519","snapshot_observed_at":"2026-08-12T06:02:52.554409Z","title":"Partafford: Part-level affordance discov- ery from 3d objects","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2411.19626","last_updated":"2025-03-29T03:46:58Z","snapshot_observed_at":"2026-08-12T05:57:13.467211Z","submitted_at":"2024-11-29T11:23:15Z","title":"GREAT: Geometry-Intention Collaborative Inference for Open-Vocabulary 3D Object Affordance Grounding","version":2},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-12T06:02:52.554409Z"},"links":{"cited_paper":"/paper/2202.13519","citing_paper":"/paper/2411.19626"},"observation_digest":"sha256:3980bb40e5b7c799348f472d9947927805b2c0159dd7e4727f174dbdff7c7551","observation_id":"9a61d1c3-4e27-4272-9dad-23c1451aa12f","resolution":{"observed_at":"2026-08-12T06:02:52.554409Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2405.12461","last_updated":"2024-05-21T02:37:45Z","snapshot_observed_at":"2026-08-11T17:44:47.468052Z","submitted_at":"2024-05-21T02:37:45Z","title":"WorldAfford: Affordance Grounding based on Natural Language Instructions","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2405.12461","snapshot_observed_at":"2026-08-12T06:02:52.558327Z","title":"Worldaf- ford: Affordance grounding based on natural language in- structions","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2411.19626","last_updated":"2025-03-29T03:46:58Z","snapshot_observed_at":"2026-08-12T05:57:13.467211Z","submitted_at":"2024-11-29T11:23:15Z","title":"GREAT: Geometry-Intention Collaborative Inference for Open-Vocabulary 3D Object Affordance Grounding","version":2},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-12T06:02:52.558327Z"},"links":{"cited_paper":"/paper/2405.12461","citing_paper":"/paper/2411.19626"},"observation_digest":"sha256:99cf5e926b8155e0bb84b5c8239e782b1a7961fa3c3fc017e1fa06b25bc207ae","observation_id":"c2082006-7463-46e7-b22e-62c3318b03a1","resolution":{"observed_at":"2026-08-12T06:02:52.558327Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2404.16821","last_updated":"2024-04-29T20:24:30Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-04-25T17:59:19Z","title":"How Far Are We to GPT-4V? Closing the Gap to Commercial Multimodal Models with Open-Source Suites","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2404.16821","snapshot_observed_at":"2026-08-12T06:02:52.562246Z","title":"How far are we to gpt-4v? closing the gap to commercial multimodal models with open-source suites","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2411.19626","last_updated":"2025-03-29T03:46:58Z","snapshot_observed_at":"2026-08-12T05:57:13.467211Z","submitted_at":"2024-11-29T11:23:15Z","title":"GREAT: Geometry-Intention Collaborative Inference for Open-Vocabulary 3D Object Affordance Grounding","version":2},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-12T06:02:52.562246Z"},"links":{"cited_paper":"/paper/2404.16821","citing_paper":"/paper/2411.19626"},"observation_digest":"sha256:e4964250b4371cda0cf0a73aec47d2324a62017499b8934b9b3a447b81dc8fcb","observation_id":"2485d54c-c721-4f28-907a-9d68d20abc0a","resolution":{"observed_at":"2026-08-12T06:02:52.562246Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2212.08051","last_updated":"2022-12-15T18:56:53Z","snapshot_observed_at":"2026-08-07T01:36:04.006725Z","submitted_at":"2022-12-15T18:56:53Z","title":"Objaverse: A Universe of Annotated 3D Objects","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2212.08051","snapshot_observed_at":"2026-08-12T06:02:52.566362Z","title":"Obja- verse: A universe of annotated 3d objects","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2411.19626","last_updated":"2025-03-29T03:46:58Z","snapshot_observed_at":"2026-08-12T05:57:13.467211Z","submitted_at":"2024-11-29T11:23:15Z","title":"GREAT: Geometry-Intention Collaborative Inference for Open-Vocabulary 3D Object Affordance Grounding","version":2},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-12T06:02:52.566362Z"},"links":{"cited_paper":"/paper/2212.08051","citing_paper":"/paper/2411.19626"},"observation_digest":"sha256:8ba9a0d660657768f333578e4640cac9ba193bec0b51ef8c093ed08995703e4e","observation_id":"348db58c-4308-46ae-b32f-eca520451bc3","resolution":{"observed_at":"2026-08-12T06:02:52.566362Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T06:02:53.412869Z","title":"3d affordancenet: A benchmark for visual object affordance understanding","venue":null,"work_id":"398c1938-b1ff-4997-ae12-e71c5ef631c8","year":2021},"citing_paper":{"arxiv_id":"2411.19626","last_updated":"2025-03-29T03:46:58Z","snapshot_observed_at":"2026-08-12T05:57:13.467211Z","submitted_at":"2024-11-29T11:23:15Z","title":"GREAT: Geometry-Intention Collaborative Inference for Open-Vocabulary 3D Object Affordance Grounding","version":2},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-12T06:02:52.570229Z"},"links":{"citing_paper":"/paper/2411.19626"},"observation_digest":"sha256:baff295fc5989e0aed292ff9133320803f5726a65304c1d3aa528554cad3c957","observation_id":"45f4506a-6af2-4a2e-9232-31b756ebdc7f","resolution":{"observed_at":"2026-08-12T06:02:53.416314Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T06:02:53.402270Z","title":"Gick and Keith J","venue":null,"work_id":"b2441ed2-4774-40ec-a98a-c390bda4eed3","year":1980},"citing_paper":{"arxiv_id":"2411.19626","last_updated":"2025-03-29T03:46:58Z","snapshot_observed_at":"2026-08-12T05:57:13.467211Z","submitted_at":"2024-11-29T11:23:15Z","title":"GREAT: Geometry-Intention Collaborative Inference for Open-Vocabulary 3D Object Affordance Grounding","version":2},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-12T06:02:52.573781Z"},"links":{"citing_paper":"/paper/2411.19626"},"observation_digest":"sha256:0c3fd0df22802e623f8c28e09000f21284e9c28d74f25e9fc5367e36810d10bb","observation_id":"ad30ad3d-6dae-46cb-9b41-d375a02eae79","resolution":{"observed_at":"2026-08-12T06:02:53.405949Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T06:02:53.392236Z","title":"Vi- sual affordance and function understanding","venue":null,"work_id":"390a6f4e-fd4d-4751-8675-c671a3905782","year":2018},"citing_paper":{"arxiv_id":"2411.19626","last_updated":"2025-03-29T03:46:58Z","snapshot_observed_at":"2026-08-12T05:57:13.467211Z","submitted_at":"2024-11-29T11:23:15Z","title":"GREAT: Geometry-Intention Collaborative Inference for Open-Vocabulary 3D Object Affordance Grounding","version":2},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-12T06:02:52.578062Z"},"links":{"citing_paper":"/paper/2411.19626"},"observation_digest":"sha256:3ee5278bc93f7eb584cc4a97c11b702b5b41651b471796470572dcc0b52c8679","observation_id":"5c84aa6d-cee5-4f7c-b433-84d8ecb6d9bd","resolution":{"observed_at":"2026-08-12T06:02:53.395772Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T06:02:53.382078Z","title":"Deep residual learning for image recognition","venue":null,"work_id":"d454ac4a-6d28-4d76-a3d6-a9c136fe9a4e","year":2016},"citing_paper":{"arxiv_id":"2411.19626","last_updated":"2025-03-29T03:46:58Z","snapshot_observed_at":"2026-08-12T05:57:13.467211Z","submitted_at":"2024-11-29T11:23:15Z","title":"GREAT: Geometry-Intention Collaborative Inference for Open-Vocabulary 3D Object Affordance Grounding","version":2},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-12T06:02:52.581199Z"},"links":{"citing_paper":"/paper/2411.19626"},"observation_digest":"sha256:2097444748255294b7bbd5d71df8111a6f276ceb40e986dbaf6296f913096bd8","observation_id":"0eec1518-beff-4c2b-b1ef-efea5daea102","resolution":{"observed_at":"2026-08-12T06:02:53.385818Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T06:02:52.584772Z","title":"LoRA: Low-rank adaptation of large language models","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2411.19626","last_updated":"2025-03-29T03:46:58Z","snapshot_observed_at":"2026-08-12T05:57:13.467211Z","submitted_at":"2024-11-29T11:23:15Z","title":"GREAT: Geometry-Intention Collaborative Inference for Open-Vocabulary 3D Object Affordance Grounding","version":2},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-12T06:02:52.584772Z"},"links":{"citing_paper":"/paper/2411.19626"},"observation_digest":"sha256:87754534799cd2f715b7b8a746dcb88e2fc429e529afe53bf0724e8a875ce406","observation_id":"0972e394-9742-4a7a-9a1b-f856c0fbe88b","resolution":{"observed_at":"2026-08-12T06:02:52.584772Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T06:02:53.365726Z","title":"Diffusion- based generation, optimization, and planning in 3d scenes","venue":null,"work_id":"07d2d981-88d4-493e-a7ec-4cc7220c833d","year":2023},"citing_paper":{"arxiv_id":"2411.19626","last_updated":"2025-03-29T03:46:58Z","snapshot_observed_at":"2026-08-12T05:57:13.467211Z","submitted_at":"2024-11-29T11:23:15Z","title":"GREAT: Geometry-Intention Collaborative Inference for Open-Vocabulary 3D Object Affordance Grounding","version":2},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-12T06:02:52.588280Z"},"links":{"citing_paper":"/paper/2411.19626"},"observation_digest":"sha256:b05b5bce324dd699d4124a04d08faf02f9de1ca06f6832db688d84caf76a9786","observation_id":"7f915c03-a4b1-41f8-bb54-1ff1bad4875b","resolution":{"observed_at":"2026-08-12T06:02:53.369168Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2409.01652","last_updated":"2024-11-12T04:33:26Z","snapshot_observed_at":"2026-07-29T23:37:00.228879Z","submitted_at":"2024-09-03T06:45:22Z","title":"ReKep: Spatio-Temporal Reasoning of Relational Keypoint Constraints for Robotic Manipulation","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2409.01652","snapshot_observed_at":"2026-08-12T06:02:52.592109Z","title":"Rekep: Spatio-temporal reasoning of rela- tional keypoint constraints for robotic manipulation","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2411.19626","last_updated":"2025-03-29T03:46:58Z","snapshot_observed_at":"2026-08-12T05:57:13.467211Z","submitted_at":"2024-11-29T11:23:15Z","title":"GREAT: Geometry-Intention Collaborative Inference for Open-Vocabulary 3D Object Affordance Grounding","version":2},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-12T06:02:52.592109Z"},"links":{"cited_paper":"/paper/2409.01652","citing_paper":"/paper/2411.19626"},"observation_digest":"sha256:769ae37ae6e33212acfcf54c2248e190ebe6cb0856bb1375a907dff94bc94941","observation_id":"8446ac65-e595-4766-a644-f1254f46cd3b","resolution":{"observed_at":"2026-08-12T06:02:52.592109Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T06:02:53.355186Z","title":"Imitation learning: A survey of learning methods","venue":null,"work_id":"bb0a8b9d-15f3-4a3a-97bc-f69686c587fc","year":2017},"citing_paper":{"arxiv_id":"2411.19626","last_updated":"2025-03-29T03:46:58Z","snapshot_observed_at":"2026-08-12T05:57:13.467211Z","submitted_at":"2024-11-29T11:23:15Z","title":"GREAT: Geometry-Intention Collaborative Inference for Open-Vocabulary 3D Object Affordance Grounding","version":2},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-12T06:02:52.595865Z"},"links":{"citing_paper":"/paper/2411.19626"},"observation_digest":"sha256:33b61e20f95d457da27bad7682d611c114e27ddde0654f1e4d2adbfdf4aeb7dd","observation_id":"c78106ed-2076-4d8d-8f2a-d403a930cd24","resolution":{"observed_at":"2026-08-12T06:02:53.358946Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T06:02:52.598976Z","title":"The ecological approach to visual percep- tion: classic edition","venue":null,"work_id":null,"year":2014},"citing_paper":{"arxiv_id":"2411.19626","last_updated":"2025-03-29T03:46:58Z","snapshot_observed_at":"2026-08-12T05:57:13.467211Z","submitted_at":"2024-11-29T11:23:15Z","title":"GREAT: Geometry-Intention Collaborative Inference for Open-Vocabulary 3D Object Affordance Grounding","version":2},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-12T06:02:52.598976Z"},"links":{"citing_paper":"/paper/2411.19626"},"observation_digest":"sha256:9be378eaf0069ae8edbffcb65ca43336cbd85b84cce8c815946c8ea6c245db3f","observation_id":"0c0a2f4f-1624-4060-81bf-ed0164b5f0c7","resolution":{"observed_at":"2026-08-12T06:02:52.598976Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2406.08394","last_updated":"2024-12-31T05:35:05Z","snapshot_observed_at":"2026-08-06T17:31:18.801416Z","submitted_at":"2024-06-12T16:44:50Z","title":"VisionLLM v2: An End-to-End Generalist Multimodal Large Language Model for Hundreds of Vision-Language Tasks","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2406.08394","snapshot_observed_at":"2026-08-12T06:02:52.602218Z","title":"Visionllm v2: An end-to-end generalist multimodal large language model for hundreds of vision-language tasks","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2411.19626","last_updated":"2025-03-29T03:46:58Z","snapshot_observed_at":"2026-08-12T05:57:13.467211Z","submitted_at":"2024-11-29T11:23:15Z","title":"GREAT: Geometry-Intention Collaborative Inference for Open-Vocabulary 3D Object Affordance Grounding","version":2},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-12T06:02:52.602218Z"},"links":{"cited_paper":"/paper/2406.08394","citing_paper":"/paper/2411.19626"},"observation_digest":"sha256:b5ef457f09c22be3b49052141cd98018cb0302d7028553580ba02206c8f7f5ae","observation_id":"3c9c18fb-80b1-45bd-bd97-f2a6130a8580","resolution":{"observed_at":"2026-08-12T06:02:52.602218Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T06:02:53.339096Z","title":"How We Reason","venue":null,"work_id":"6563ea48-0cd5-451e-8d79-ac79bcf7273d","year":2008},"citing_paper":{"arxiv_id":"2411.19626","last_updated":"2025-03-29T03:46:58Z","snapshot_observed_at":"2026-08-12T05:57:13.467211Z","submitted_at":"2024-11-29T11:23:15Z","title":"GREAT: Geometry-Intention Collaborative Inference for Open-Vocabulary 3D Object Affordance Grounding","version":2},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-12T06:02:52.605572Z"},"links":{"citing_paper":"/paper/2411.19626"},"observation_digest":"sha256:0466ab84854355488111aed986c5441553854703788a9156c00729424656a7ec","observation_id":"e88e393c-200b-42b6-a87d-2b040ddff493","resolution":{"observed_at":"2026-08-12T06:02:53.342396Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T06:02:53.328469Z","title":"Sukhatme","venue":null,"work_id":"8e4b79c8-d843-42f0-b084-cd4c7d7285f7","year":2014},"citing_paper":{"arxiv_id":"2411.19626","last_updated":"2025-03-29T03:46:58Z","snapshot_observed_at":"2026-08-12T05:57:13.467211Z","submitted_at":"2024-11-29T11:23:15Z","title":"GREAT: Geometry-Intention Collaborative Inference for Open-Vocabulary 3D Object Affordance Grounding","version":2},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-12T06:02:52.608437Z"},"links":{"citing_paper":"/paper/2411.19626"},"observation_digest":"sha256:a4839d9544f707ec6d86afbfa7ed7d7886bbaa749590ec96e6d19c892b2cee7c","observation_id":"2efcf583-a5bb-4ed9-bcea-5307e755b0d9","resolution":{"observed_at":"2026-08-12T06:02:53.332380Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T06:02:53.318056Z","title":"Openimages: A public dataset for large-scale multi- label and multi-class image classification","venue":null,"work_id":"61344040-e84b-49ad-923f-5b7fcd2f003e","year":2017},"citing_paper":{"arxiv_id":"2411.19626","last_updated":"2025-03-29T03:46:58Z","snapshot_observed_at":"2026-08-12T05:57:13.467211Z","submitted_at":"2024-11-29T11:23:15Z","title":"GREAT: Geometry-Intention Collaborative Inference for Open-Vocabulary 3D Object Affordance Grounding","version":2},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-12T06:02:52.611478Z"},"links":{"citing_paper":"/paper/2411.19626"},"observation_digest":"sha256:4461121958a0f990dc0193d3eec1d9f3765468fcea797e40b293fa00d9a1b173","observation_id":"647463fe-6927-4764-ac47-6a7330114ca1","resolution":{"observed_at":"2026-08-12T06:02:53.321827Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T06:02:53.307701Z","title":"Ram: Retrieval-based affordance transfer for generalizable zero-shot robotic manipulation, 2024","venue":null,"work_id":"a40660c4-b8d8-4ea3-9c6c-d3b57401627c","year":2024},"citing_paper":{"arxiv_id":"2411.19626","last_updated":"2025-03-29T03:46:58Z","snapshot_observed_at":"2026-08-12T05:57:13.467211Z","submitted_at":"2024-11-29T11:23:15Z","title":"GREAT: Geometry-Intention Collaborative Inference for Open-Vocabulary 3D Object Affordance Grounding","version":2},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-12T06:02:52.614770Z"},"links":{"citing_paper":"/paper/2411.19626"},"observation_digest":"sha256:d308605f707cd19e11f1ac25bda1dfe165cc6648e296a0ea8467244dcbb2809b","observation_id":"9755de71-77d5-41e9-a82b-69cc0670a019","resolution":{"observed_at":"2026-08-12T06:02:53.311417Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T06:02:53.297095Z","title":"Boosting logical reasoning in large language models through a new framework: The graph of thought, 2023","venue":null,"work_id":"872cfbbd-75f9-4adb-b770-dddaf189220d","year":2023},"citing_paper":{"arxiv_id":"2411.19626","last_updated":"2025-03-29T03:46:58Z","snapshot_observed_at":"2026-08-12T05:57:13.467211Z","submitted_at":"2024-11-29T11:23:15Z","title":"GREAT: Geometry-Intention Collaborative Inference for Open-Vocabulary 3D Object Affordance Grounding","version":2},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-12T06:02:52.617879Z"},"links":{"citing_paper":"/paper/2411.19626"},"observation_digest":"sha256:94c8d5f4a1595d6e70b5024bd81c80bad8f74496cda014bf17aca24816814535","observation_id":"d62ffc84-0e96-475f-95d3-4690bacdd105","resolution":{"observed_at":"2026-08-12T06:02:53.300961Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T06:02:53.286355Z","title":"One-shot open affordance learning with foundation models","venue":null,"work_id":"5fdcdd04-49ae-44cd-90b6-88c1355a1cf0","year":2024},"citing_paper":{"arxiv_id":"2411.19626","last_updated":"2025-03-29T03:46:58Z","snapshot_observed_at":"2026-08-12T05:57:13.467211Z","submitted_at":"2024-11-29T11:23:15Z","title":"GREAT: Geometry-Intention Collaborative Inference for Open-Vocabulary 3D Object Affordance Grounding","version":2},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-12T06:02:52.620882Z"},"links":{"citing_paper":"/paper/2411.19626"},"observation_digest":"sha256:6cd5f5e592738f929b935478b4c27f7afdb947510e84eacdf835098a9c980697","observation_id":"d6b04fd0-883e-4cc2-9278-dfcbad998d12","resolution":{"observed_at":"2026-08-12T06:02:53.290023Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T06:02:53.276310Z","title":"Blip: Bootstrapping language-image pre-training for unified vision-language understanding and generation, 2022","venue":null,"work_id":"8b8607b6-ba4c-4712-a55f-aea52c11e397","year":2022},"citing_paper":{"arxiv_id":"2411.19626","last_updated":"2025-03-29T03:46:58Z","snapshot_observed_at":"2026-08-12T05:57:13.467211Z","submitted_at":"2024-11-29T11:23:15Z","title":"GREAT: Geometry-Intention Collaborative Inference for Open-Vocabulary 3D Object Affordance Grounding","version":2},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-12T06:02:52.623969Z"},"links":{"citing_paper":"/paper/2411.19626"},"observation_digest":"sha256:823443a7d34c1d5564e55b28a12f037705b358de4226ff0047282963faad7a5e","observation_id":"9e91f4e3-f6a7-4df0-aba4-9db272ef01b4","resolution":{"observed_at":"2026-08-12T06:02:53.279972Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2404.17521","last_updated":"2024-04-26T16:40:17Z","snapshot_observed_at":"2026-07-06T18:06:12.068436Z","submitted_at":"2024-04-26T16:40:17Z","title":"Ag2Manip: Learning Novel Manipulation Skills with Agent-Agnostic Visual and Action Representations","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2404.17521","snapshot_observed_at":"2026-08-12T06:02:52.626899Z","title":"Ag2manip: Learning novel manipulation skills with agent- agnostic visual and action representations","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2411.19626","last_updated":"2025-03-29T03:46:58Z","snapshot_observed_at":"2026-08-12T05:57:13.467211Z","submitted_at":"2024-11-29T11:23:15Z","title":"GREAT: Geometry-Intention Collaborative Inference for Open-Vocabulary 3D Object Affordance Grounding","version":2},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-12T06:02:52.626899Z"},"links":{"cited_paper":"/paper/2404.17521","citing_paper":"/paper/2411.19626"},"observation_digest":"sha256:b9d68157ebeed32f23707dca8ade15fe743e19df475bb5e54a1e8a1e3bbd0811","observation_id":"6c019249-49b1-4973-b684-958c3590c318","resolution":{"observed_at":"2026-08-12T06:02:52.626899Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T06:02:52.630168Z","title":"Manipllm: Embodied multimodal large language model for object-centric robotic manipulation","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2411.19626","last_updated":"2025-03-29T03:46:58Z","snapshot_observed_at":"2026-08-12T05:57:13.467211Z","submitted_at":"2024-11-29T11:23:15Z","title":"GREAT: Geometry-Intention Collaborative Inference for Open-Vocabulary 3D Object Affordance Grounding","version":2},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-12T06:02:52.630168Z"},"links":{"citing_paper":"/paper/2411.19626"},"observation_digest":"sha256:c19630b38924764c8a98b3b504471c3170e5f040fac783c0291140859bcaefbe","observation_id":"d8383c0d-1711-45c0-b893-00a19c4f67c5","resolution":{"observed_at":"2026-08-12T06:02:52.630168Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T06:02:53.260151Z","title":null,"venue":null,"work_id":"a374f27a-57f6-4109-acdd-8e4196047930","year":2024},"citing_paper":{"arxiv_id":"2411.19626","last_updated":"2025-03-29T03:46:58Z","snapshot_observed_at":"2026-08-12T05:57:13.467211Z","submitted_at":"2024-11-29T11:23:15Z","title":"GREAT: Geometry-Intention Collaborative Inference for Open-Vocabulary 3D Object Affordance Grounding","version":2},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-08-12T06:02:52.633422Z"},"links":{"citing_paper":"/paper/2411.19626"},"observation_digest":"sha256:a9637e3aeefe87c15af7a68e640f8e772e93ac0d1f4e965d26443d36247e9182","observation_id":"72cea7d0-2004-4df0-8953-65939da48297","resolution":{"observed_at":"2026-08-12T06:02:53.263748Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T06:02:53.249479Z","title":"Focal loss for dense object detection","venue":null,"work_id":"d53e0cac-943e-4a9f-924e-c76fcd6ba58e","year":2020},"citing_paper":{"arxiv_id":"2411.19626","last_updated":"2025-03-29T03:46:58Z","snapshot_observed_at":"2026-08-12T05:57:13.467211Z","submitted_at":"2024-11-29T11:23:15Z","title":"GREAT: Geometry-Intention Collaborative Inference for Open-Vocabulary 3D Object Affordance Grounding","version":2},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-08-12T06:02:52.636305Z"},"links":{"citing_paper":"/paper/2411.19626"},"observation_digest":"sha256:903c30640de36b214fae366457977e6da5853ad5ab169d482deba033a09786d6","observation_id":"0ff662bd-0b1f-4c6c-b889-a46b6374c38d","resolution":{"observed_at":"2026-08-12T06:02:53.253863Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2409.19650","last_updated":"2024-09-29T10:46:19Z","snapshot_observed_at":"2026-08-11T09:47:11.248277Z","submitted_at":"2024-09-29T10:46:19Z","title":"Grounding 3D Scene Affordance From Egocentric Interactions","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2409.19650","snapshot_observed_at":"2026-08-12T06:02:52.639625Z","title":"Grounding 3d scene affordance from egocentric interactions","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2411.19626","last_updated":"2025-03-29T03:46:58Z","snapshot_observed_at":"2026-08-12T05:57:13.467211Z","submitted_at":"2024-11-29T11:23:15Z","title":"GREAT: Geometry-Intention Collaborative Inference for Open-Vocabulary 3D Object Affordance Grounding","version":2},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-08-12T06:02:52.639625Z"},"links":{"cited_paper":"/paper/2409.19650","citing_paper":"/paper/2411.19626"},"observation_digest":"sha256:fee356d4c495abe77e15c8227d8288dea45925c98130bc646aa977d1c9937a8a","observation_id":"72b59d6e-cd49-45fd-a898-9f6431b7a962","resolution":{"observed_at":"2026-08-12T06:02:52.639625Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T06:02:53.239937Z","title":"Roberta: A robustly optimized bert pretraining approach, 2019","venue":null,"work_id":"ba13bad3-a61f-445e-bcac-b4668902f68a","year":2019},"citing_paper":{"arxiv_id":"2411.19626","last_updated":"2025-03-29T03:46:58Z","snapshot_observed_at":"2026-08-12T05:57:13.467211Z","submitted_at":"2024-11-29T11:23:15Z","title":"GREAT: Geometry-Intention Collaborative Inference for Open-Vocabulary 3D Object Affordance Grounding","version":2},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-08-12T06:02:52.642873Z"},"links":{"citing_paper":"/paper/2411.19626"},"observation_digest":"sha256:32aea8b54a56631188a17b74dea478d7359c6906c441d40fc2d93f3d7c99ef8f","observation_id":"ec0ed283-c712-4093-89a4-5d82c4036123","resolution":{"observed_at":"2026-08-12T06:02:53.243384Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T06:02:53.231013Z","title":"Lobo, Alberto Jiménez-Valverde, and Raimundo Real","venue":null,"work_id":"52eb3496-940e-4803-9475-6ad63e18ac51","year":2008},"citing_paper":{"arxiv_id":"2411.19626","last_updated":"2025-03-29T03:46:58Z","snapshot_observed_at":"2026-08-12T05:57:13.467211Z","submitted_at":"2024-11-29T11:23:15Z","title":"GREAT: Geometry-Intention Collaborative Inference for Open-Vocabulary 3D Object Affordance Grounding","version":2},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-08-12T06:02:52.645855Z"},"links":{"citing_paper":"/paper/2411.19626"},"observation_digest":"sha256:56552de85cdd828b33ea8e12d1f608dae4e5c0eb45c87a517a2f4114664f84d5","observation_id":"b73b7471-9cb9-40ee-8653-c12b2c4ec195","resolution":{"observed_at":"2026-08-12T06:02:53.234164Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T06:02:53.221588Z","title":"Phrase-based affordance detection via cyclic bilateral inter- action","venue":null,"work_id":"a76d5143-85b9-4352-aeb2-7fc384f01add","year":2022},"citing_paper":{"arxiv_id":"2411.19626","last_updated":"2025-03-29T03:46:58Z","snapshot_observed_at":"2026-08-12T05:57:13.467211Z","submitted_at":"2024-11-29T11:23:15Z","title":"GREAT: Geometry-Intention Collaborative Inference for Open-Vocabulary 3D Object Affordance Grounding","version":2},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-08-12T06:02:52.648769Z"},"links":{"citing_paper":"/paper/2411.19626"},"observation_digest":"sha256:7e5ee1c7a98d4cadcf6348a4341da7f093e1c64b2b04cf0a70c8dc82326456cb","observation_id":"4900fa6d-f017-41e3-8cc9-f514c52a6068","resolution":{"observed_at":"2026-08-12T06:02:53.225234Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T06:02:53.212796Z","title":"One-shot affordance detection","venue":null,"work_id":"f879f6c3-fdbd-46d8-9219-d83e323f183d","year":null},"citing_paper":{"arxiv_id":"2411.19626","last_updated":"2025-03-29T03:46:58Z","snapshot_observed_at":"2026-08-12T05:57:13.467211Z","submitted_at":"2024-11-29T11:23:15Z","title":"GREAT: Geometry-Intention Collaborative Inference for Open-Vocabulary 3D Object Affordance Grounding","version":2},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-08-12T06:02:52.651926Z"},"links":{"citing_paper":"/paper/2411.19626"},"observation_digest":"sha256:41e7ed0675816c71c33d1c4e7122102ad69329d4d986490316f7c97832683935","observation_id":"55653c24-6889-4f50-93a3-a29be1d36f32","resolution":{"observed_at":"2026-08-12T06:02:53.215976Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T06:02:53.203375Z","title":"Learning affordance grounding from exocen- tric images","venue":null,"work_id":"fbd394bb-1c55-4bab-89e2-f6f28c499f5c","year":2022},"citing_paper":{"arxiv_id":"2411.19626","last_updated":"2025-03-29T03:46:58Z","snapshot_observed_at":"2026-08-12T05:57:13.467211Z","submitted_at":"2024-11-29T11:23:15Z","title":"GREAT: Geometry-Intention Collaborative Inference for Open-Vocabulary 3D Object Affordance Grounding","version":2},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-08-12T06:02:52.654927Z"},"links":{"citing_paper":"/paper/2411.19626"},"observation_digest":"sha256:671060b31565e6d7bb284ae75faf614c960f7b9d640c852acffad44471c0846a","observation_id":"da26d0f6-b5b6-4655-8c65-bd4fe9bfb94d","resolution":{"observed_at":"2026-08-12T06:02:53.207005Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T06:02:53.193936Z","title":"Leverage interactive affinity for affordance learning","venue":null,"work_id":"a11b351e-19ae-44bc-bc0f-03335ad7e3ab","year":2023},"citing_paper":{"arxiv_id":"2411.19626","last_updated":"2025-03-29T03:46:58Z","snapshot_observed_at":"2026-08-12T05:57:13.467211Z","submitted_at":"2024-11-29T11:23:15Z","title":"GREAT: Geometry-Intention Collaborative Inference for Open-Vocabulary 3D Object Affordance Grounding","version":2},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-08-12T06:02:52.657950Z"},"links":{"citing_paper":"/paper/2411.19626"},"observation_digest":"sha256:45c32abcf3294f10d8c82ac924ae138277a5b5fd878bbcc1b1542f4f542451c7","observation_id":"874390b1-d417-4962-9356-957ad3808d71","resolution":{"observed_at":"2026-08-12T06:02:53.197127Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T06:02:53.185265Z","title":"Learning visual affordance grounding from demonstration videos","venue":null,"work_id":"9993bd94-a0a0-4a35-a140-ef4b4f2c1ae7","year":2024},"citing_paper":{"arxiv_id":"2411.19626","last_updated":"2025-03-29T03:46:58Z","snapshot_observed_at":"2026-08-12T05:57:13.467211Z","submitted_at":"2024-11-29T11:23:15Z","title":"GREAT: Geometry-Intention Collaborative Inference for Open-Vocabulary 3D Object Affordance Grounding","version":2},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-08-12T06:02:52.661310Z"},"links":{"citing_paper":"/paper/2411.19626"},"observation_digest":"sha256:4712445aa480f47b82578c09b5d2ce62164889faa8110f05fda24427fb83acbe","observation_id":"f44efe19-4a91-4951-ac8a-4e5a00a18922","resolution":{"observed_at":"2026-08-12T06:02:53.188560Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T06:02:53.175672Z","title":"Madiff: Motion-aware mamba diffusion models for hand trajectory prediction on egocentric videos, 2024","venue":null,"work_id":"dc2c9f05-4033-4c66-990d-9cd9e396f7c6","year":2024},"citing_paper":{"arxiv_id":"2411.19626","last_updated":"2025-03-29T03:46:58Z","snapshot_observed_at":"2026-08-12T05:57:13.467211Z","submitted_at":"2024-11-29T11:23:15Z","title":"GREAT: Geometry-Intention Collaborative Inference for Open-Vocabulary 3D Object Affordance Grounding","version":2},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-08-12T06:02:52.665383Z"},"links":{"citing_paper":"/paper/2411.19626"},"observation_digest":"sha256:c2f02a191ddc2a0d90ce83bcd2a221af2ddbc9afb78e2433ec96adc8798894e8","observation_id":"07b36d37-a9dc-42b1-8739-2803c6a2fe53","resolution":{"observed_at":"2026-08-12T06:02:53.179647Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T06:02:53.166085Z","title":"Gpt-driver: Learning to drive with gpt, 2023","venue":null,"work_id":"677f70d3-6462-4d4e-8865-ded3314c35af","year":2023},"citing_paper":{"arxiv_id":"2411.19626","last_updated":"2025-03-29T03:46:58Z","snapshot_observed_at":"2026-08-12T05:57:13.467211Z","submitted_at":"2024-11-29T11:23:15Z","title":"GREAT: Geometry-Intention Collaborative Inference for Open-Vocabulary 3D Object Affordance Grounding","version":2},"reference_index":36,"source":"pdf_text","source_observed_at":"2026-08-12T06:02:52.668512Z"},"links":{"citing_paper":"/paper/2411.19626"},"observation_digest":"sha256:fe65941cda83dd8e94e0ed37e81b6bdfdd0d9446865576ba1a97cc373e6e872e","observation_id":"d9df6a0a-dd64-44b0-976a-ad1b4d05e4ef","resolution":{"observed_at":"2026-08-12T06:02:53.169579Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T06:02:53.156609Z","title":"V-net: Fully convolutional neural networks for volumetric medical image segmentation","venue":null,"work_id":"2b99b9ca-668e-47e7-8c31-ef48243cc701","year":2016},"citing_paper":{"arxiv_id":"2411.19626","last_updated":"2025-03-29T03:46:58Z","snapshot_observed_at":"2026-08-12T05:57:13.467211Z","submitted_at":"2024-11-29T11:23:15Z","title":"GREAT: Geometry-Intention Collaborative Inference for Open-Vocabulary 3D Object Affordance Grounding","version":2},"reference_index":37,"source":"pdf_text","source_observed_at":"2026-08-12T06:02:52.671650Z"},"links":{"citing_paper":"/paper/2411.19626"},"observation_digest":"sha256:f9045acff412b026e94d66393b01d8d9d667d2fc417ee20632036f0cd18d446d","observation_id":"697f295f-7c00-4050-8ea5-705801d04d51","resolution":{"observed_at":"2026-08-12T06:02:53.160144Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T06:02:52.674685Z","title":"Chang, Li Yi, Subarna Tripathi, Leonidas J","venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2411.19626","last_updated":"2025-03-29T03:46:58Z","snapshot_observed_at":"2026-08-12T05:57:13.467211Z","submitted_at":"2024-11-29T11:23:15Z","title":"GREAT: Geometry-Intention Collaborative Inference for Open-Vocabulary 3D Object Affordance Grounding","version":2},"reference_index":38,"source":"pdf_text","source_observed_at":"2026-08-12T06:02:52.674685Z"},"links":{"citing_paper":"/paper/2411.19626"},"observation_digest":"sha256:f99aacd92fa9c79c440e04147f73bc60341ef4c1312b78ba40dec633cb64caf7","observation_id":"6412561c-f851-4551-8fb2-d105f8186a5b","resolution":{"observed_at":"2026-08-12T06:02:52.674685Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T06:02:53.141503Z","title":"O2O-Afford: Annotation-free large-scale object-object affordance learning","venue":null,"work_id":"09e65e1f-fa82-44df-904b-279bb8778b8b","year":2021},"citing_paper":{"arxiv_id":"2411.19626","last_updated":"2025-03-29T03:46:58Z","snapshot_observed_at":"2026-08-12T05:57:13.467211Z","submitted_at":"2024-11-29T11:23:15Z","title":"GREAT: Geometry-Intention Collaborative Inference for Open-Vocabulary 3D Object Affordance Grounding","version":2},"reference_index":39,"source":"pdf_text","source_observed_at":"2026-08-12T06:02:52.677741Z"},"links":{"citing_paper":"/paper/2411.19626"},"observation_digest":"sha256:0105348521ed660c8bc806aa2e66c5b38787104284059cd6bbae9f9c98dfa5a7","observation_id":"8ca127e2-57c0-4bbb-9f59-a3ab18191bf1","resolution":{"observed_at":"2026-08-12T06:02:53.144857Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T06:02:53.132124Z","title":"Learning relational affor- dance models for robots in multi-object manipulation tasks","venue":null,"work_id":"d913a1a3-cb36-40b6-8da2-33f0b40aefb0","year":2012},"citing_paper":{"arxiv_id":"2411.19626","last_updated":"2025-03-29T03:46:58Z","snapshot_observed_at":"2026-08-12T05:57:13.467211Z","submitted_at":"2024-11-29T11:23:15Z","title":"GREAT: Geometry-Intention Collaborative Inference for Open-Vocabulary 3D Object Affordance Grounding","version":2},"reference_index":40,"source":"pdf_text","source_observed_at":"2026-08-12T06:02:52.680906Z"},"links":{"citing_paper":"/paper/2411.19626"},"observation_digest":"sha256:1d2d6c2acfd54ff0cd26d19bad894dff6d96e5fde96a83c02fee62f1d551a150","observation_id":"86fc1438-2b56-4f9b-8df4-81cc28758b7d","resolution":{"observed_at":"2026-08-12T06:02:53.135535Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T06:02:53.122514Z","title":"Open-vocabulary af- fordance detection in 3d point clouds","venue":null,"work_id":"faab0319-000d-41c6-ba56-771a7f1a9905","year":2023},"citing_paper":{"arxiv_id":"2411.19626","last_updated":"2025-03-29T03:46:58Z","snapshot_observed_at":"2026-08-12T05:57:13.467211Z","submitted_at":"2024-11-29T11:23:15Z","title":"GREAT: Geometry-Intention Collaborative Inference for Open-Vocabulary 3D Object Affordance Grounding","version":2},"reference_index":41,"source":"pdf_text","source_observed_at":"2026-08-12T06:02:52.684058Z"},"links":{"citing_paper":"/paper/2411.19626"},"observation_digest":"sha256:04155121cda3a1bcfd08094773d35346e44bb42f362ec8e354a73b43923dc1e0","observation_id":"fb9a09e9-c509-4122-aa49-ae50bc0cb5b9","resolution":{"observed_at":"2026-08-12T06:02:53.125995Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T06:02:53.113000Z","title":"Global-local collab- orative inference with llm for lidar-based open-vocabulary detection, 2024","venue":null,"work_id":"a746a6fb-684d-4f56-95a5-aa61532f0f44","year":2024},"citing_paper":{"arxiv_id":"2411.19626","last_updated":"2025-03-29T03:46:58Z","snapshot_observed_at":"2026-08-12T05:57:13.467211Z","submitted_at":"2024-11-29T11:23:15Z","title":"GREAT: Geometry-Intention Collaborative Inference for Open-Vocabulary 3D Object Affordance Grounding","version":2},"reference_index":42,"source":"pdf_text","source_observed_at":"2026-08-12T06:02:52.686966Z"},"links":{"citing_paper":"/paper/2411.19626"},"observation_digest":"sha256:caacbb9ea22ee821f0a66770be1cc811b5eb1ed74265c2ed92cd5049ec8c9e62","observation_id":"bbd15e74-6eca-44ba-ad09-931f3c474faa","resolution":{"observed_at":"2026-08-12T06:02:53.116448Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1706.02413","last_updated":"2017-06-07T23:37:44Z","snapshot_observed_at":"2026-07-06T05:46:01.107746Z","submitted_at":"2017-06-07T23:37:44Z","title":"PointNet++: Deep Hierarchical Feature Learning on Point Sets in a Metric Space","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1706.02413","snapshot_observed_at":"2026-08-12T06:02:52.690132Z","title":"Point- net++: Deep hierarchical feature learning on point sets in a metric space","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2411.19626","last_updated":"2025-03-29T03:46:58Z","snapshot_observed_at":"2026-08-12T05:57:13.467211Z","submitted_at":"2024-11-29T11:23:15Z","title":"GREAT: Geometry-Intention Collaborative Inference for Open-Vocabulary 3D Object Affordance Grounding","version":2},"reference_index":43,"source":"pdf_text","source_observed_at":"2026-08-12T06:02:52.690132Z"},"links":{"cited_paper":"/paper/1706.02413","citing_paper":"/paper/2411.19626"},"observation_digest":"sha256:86bc97a7c163ae86d3e065e6b70aca575a5765b8ae527189c1dcbf785b4b7fd2","observation_id":"a739a6b9-7731-4b8c-b472-76230a3e2b92","resolution":{"observed_at":"2026-08-12T06:02:52.690132Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T06:02:52.693627Z","title":"Affordancellm: Grounding affordance from vision language models","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2411.19626","last_updated":"2025-03-29T03:46:58Z","snapshot_observed_at":"2026-08-12T05:57:13.467211Z","submitted_at":"2024-11-29T11:23:15Z","title":"GREAT: Geometry-Intention Collaborative Inference for Open-Vocabulary 3D Object Affordance Grounding","version":2},"reference_index":44,"source":"pdf_text","source_observed_at":"2026-08-12T06:02:52.693627Z"},"links":{"citing_paper":"/paper/2411.19626"},"observation_digest":"sha256:89af01d13abec933f4093cc027230c52a5d843851b90e360574298c9a9297182","observation_id":"43c94500-a534-482e-8338-3d741d23b74d","resolution":{"observed_at":"2026-08-12T06:02:52.693627Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T06:02:53.098149Z","title":"Optimizing intersection-over-union in deep neural networks for image segmentation","venue":null,"work_id":"b1a63307-2880-48a2-b823-4f64547a94ad","year":2016},"citing_paper":{"arxiv_id":"2411.19626","last_updated":"2025-03-29T03:46:58Z","snapshot_observed_at":"2026-08-12T05:57:13.467211Z","submitted_at":"2024-11-29T11:23:15Z","title":"GREAT: Geometry-Intention Collaborative Inference for Open-Vocabulary 3D Object Affordance Grounding","version":2},"reference_index":45,"source":"pdf_text","source_observed_at":"2026-08-12T06:02:52.696656Z"},"links":{"citing_paper":"/paper/2411.19626"},"observation_digest":"sha256:0d68813014d244d7fc9acaa4abc30302540a0bc8b0552389b8ef9e393ba6f4d7","observation_id":"3f0a58b0-77ec-4eaa-a550-f56789f8ee12","resolution":{"observed_at":"2026-08-12T06:02:53.101616Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2201.12296","last_updated":"2022-01-28T18:01:42Z","snapshot_observed_at":"2026-08-09T11:20:50.715055Z","submitted_at":"2022-01-28T18:01:42Z","title":"Benchmarking Robustness of 3D Point Cloud Recognition Against Common Corruptions","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2201.12296","snapshot_observed_at":"2026-08-12T06:02:52.699914Z","title":"Morley Mao","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2411.19626","last_updated":"2025-03-29T03:46:58Z","snapshot_observed_at":"2026-08-12T05:57:13.467211Z","submitted_at":"2024-11-29T11:23:15Z","title":"GREAT: Geometry-Intention Collaborative Inference for Open-Vocabulary 3D Object Affordance Grounding","version":2},"reference_index":46,"source":"pdf_text","source_observed_at":"2026-08-12T06:02:52.699914Z"},"links":{"cited_paper":"/paper/2201.12296","citing_paper":"/paper/2411.19626"},"observation_digest":"sha256:1468dff6b7a2e2384f8dc337bea1823e5905655630f8e362b22d2f6834fc49a0","observation_id":"40fcc66b-e451-4b3f-8e20-1b5e28e84a2c","resolution":{"observed_at":"2026-08-12T06:02:52.699914Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T06:02:53.089455Z","title":"Swain and Dana H","venue":null,"work_id":"36670134-dff7-45ee-9d29-b3e089e65484","year":1991},"citing_paper":{"arxiv_id":"2411.19626","last_updated":"2025-03-29T03:46:58Z","snapshot_observed_at":"2026-08-12T05:57:13.467211Z","submitted_at":"2024-11-29T11:23:15Z","title":"GREAT: Geometry-Intention Collaborative Inference for Open-Vocabulary 3D Object Affordance Grounding","version":2},"reference_index":47,"source":"pdf_text","source_observed_at":"2026-08-12T06:02:52.703216Z"},"links":{"citing_paper":"/paper/2411.19626"},"observation_digest":"sha256:8186eb6d26e4e9df06b50c1b771305facb986053b90eb33e9ff7af15312ac0d7","observation_id":"d4f899ed-8f4a-4d3b-b34e-d3efd68bef83","resolution":{"observed_at":"2026-08-12T06:02:53.092759Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T06:02:53.079768Z","title":"Cot- det: Affordance knowledge prompting for task driven object detection","venue":null,"work_id":"9adb9085-e292-4296-a278-15249fd64e4c","year":null},"citing_paper":{"arxiv_id":"2411.19626","last_updated":"2025-03-29T03:46:58Z","snapshot_observed_at":"2026-08-12T05:57:13.467211Z","submitted_at":"2024-11-29T11:23:15Z","title":"GREAT: Geometry-Intention Collaborative Inference for Open-Vocabulary 3D Object Affordance Grounding","version":2},"reference_index":48,"source":"pdf_text","source_observed_at":"2026-08-12T06:02:52.706259Z"},"links":{"citing_paper":"/paper/2411.19626"},"observation_digest":"sha256:5d3d5d4982b1efc07a2d56114858a48ae7963cc81c9870f82b22c00ceeeb97d9","observation_id":"d696d0f0-9278-43c0-8cfa-dbf807baf48e","resolution":{"observed_at":"2026-08-12T06:02:53.083680Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T06:02:53.070079Z","title":"Llama: Open and efficient foundation lan- guage models, 2023","venue":null,"work_id":"a0fdffcd-1c7b-4e92-a5f5-fe4bf396e116","year":2023},"citing_paper":{"arxiv_id":"2411.19626","last_updated":"2025-03-29T03:46:58Z","snapshot_observed_at":"2026-08-12T05:57:13.467211Z","submitted_at":"2024-11-29T11:23:15Z","title":"GREAT: Geometry-Intention Collaborative Inference for Open-Vocabulary 3D Object Affordance Grounding","version":2},"reference_index":49,"source":"pdf_text","source_observed_at":"2026-08-12T06:02:52.709497Z"},"links":{"citing_paper":"/paper/2411.19626"},"observation_digest":"sha256:79cbf19064a03abb0fd0344e774eb8df1bf6d07f1560d92a3f1af372304b7e39","observation_id":"d67c3dba-dbd9-4e41-87fb-afbc0aa697fa","resolution":{"observed_at":"2026-08-12T06:02:53.073480Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T06:02:53.060410Z","title":"Open-vocabulary affordance detection using knowledge distillation and text- point correlation","venue":null,"work_id":"d2224fd5-8f6a-41d4-b3fb-709be6645d9a","year":2024},"citing_paper":{"arxiv_id":"2411.19626","last_updated":"2025-03-29T03:46:58Z","snapshot_observed_at":"2026-08-12T05:57:13.467211Z","submitted_at":"2024-11-29T11:23:15Z","title":"GREAT: Geometry-Intention Collaborative Inference for Open-Vocabulary 3D Object Affordance Grounding","version":2},"reference_index":50,"source":"pdf_text","source_observed_at":"2026-08-12T06:02:52.712524Z"},"links":{"citing_paper":"/paper/2411.19626"},"observation_digest":"sha256:c626dcd92ba4e99104a591a6317b9e8b4fc18ec0364e4b2467b90c26d098324f","observation_id":"cde8668e-9714-443a-8c29-06f21459a3dc","resolution":{"observed_at":"2026-08-12T06:02:53.063818Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2201.11903","last_updated":"2023-01-10T23:07:57Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2022-01-28T02:33:07Z","title":"Chain-of-Thought Prompting Elicits Reasoning in Large Language Models","version":6},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2201.11903","snapshot_observed_at":"2026-08-12T06:02:52.715926Z","title":"Chi, Quoc Le, and Denny Zhou","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2411.19626","last_updated":"2025-03-29T03:46:58Z","snapshot_observed_at":"2026-08-12T05:57:13.467211Z","submitted_at":"2024-11-29T11:23:15Z","title":"GREAT: Geometry-Intention Collaborative Inference for Open-Vocabulary 3D Object Affordance Grounding","version":2},"reference_index":51,"source":"pdf_text","source_observed_at":"2026-08-12T06:02:52.715926Z"},"links":{"cited_paper":"/paper/2201.11903","citing_paper":"/paper/2411.19626"},"observation_digest":"sha256:3f02345f5e6f46f9c3350e70f4a6b6bea0a0652e51628f458abbc5e96a71604a","observation_id":"d639b416-abf0-4947-9345-307eeb07ee34","resolution":{"observed_at":"2026-08-12T06:02:52.715926Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T06:02:53.051197Z","title":"Willmott and Kenji Matsuura","venue":null,"work_id":"004423f6-bbe8-4dfe-8e65-a8f7345191de","year":2005},"citing_paper":{"arxiv_id":"2411.19626","last_updated":"2025-03-29T03:46:58Z","snapshot_observed_at":"2026-08-12T05:57:13.467211Z","submitted_at":"2024-11-29T11:23:15Z","title":"GREAT: Geometry-Intention Collaborative Inference for Open-Vocabulary 3D Object Affordance Grounding","version":2},"reference_index":52,"source":"pdf_text","source_observed_at":"2026-08-12T06:02:52.719425Z"},"links":{"citing_paper":"/paper/2411.19626"},"observation_digest":"sha256:5d38aabfda3a6624190535d3783a9eed20ba2aa9a1ecca949e6c2949f844f8b9","observation_id":"ea1ebfb5-d45c-4634-ab22-24975b0bc29b","resolution":{"observed_at":"2026-08-12T06:02:53.054358Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T06:02:53.042112Z","title":"Det- toolchain: A new prompting paradigm to unleash detection ability of mllm, 2024","venue":null,"work_id":"2885c314-c324-4aaa-90bb-1ac0b7000ed8","year":2024},"citing_paper":{"arxiv_id":"2411.19626","last_updated":"2025-03-29T03:46:58Z","snapshot_observed_at":"2026-08-12T05:57:13.467211Z","submitted_at":"2024-11-29T11:23:15Z","title":"GREAT: Geometry-Intention Collaborative Inference for Open-Vocabulary 3D Object Affordance Grounding","version":2},"reference_index":53,"source":"pdf_text","source_observed_at":"2026-08-12T06:02:52.722414Z"},"links":{"citing_paper":"/paper/2411.19626"},"observation_digest":"sha256:6484fd9b393b4b770ae96dc2c42eb49cdbeb6333fb3fa6f692b441c1d8c93a65","observation_id":"d7618818-4341-45d9-aa67-9ad9868ba8bd","resolution":{"observed_at":"2026-08-12T06:02:53.045347Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2209.10733","last_updated":"2022-09-22T02:07:25Z","snapshot_observed_at":"2026-07-06T13:55:00.400031Z","submitted_at":"2022-09-22T02:07:25Z","title":"FusionRCNN: LiDAR-Camera Fusion for Two-stage 3D Object Detection","version":1},"cited_work":{"arxiv_id":"2209.10733","doi":null,"metadata_source":"pith","pith_arxiv_id":"2209.10733","snapshot_observed_at":"2026-08-12T06:02:52.857447Z","title":"FusionRCNN: LiDAR-Camera Fusion for Two-stage 3D Object Detection","venue":"cs.CV","work_id":"0bd1ce25-1207-4c62-89aa-5fb79e7f2e64","year":2022},"citing_paper":{"arxiv_id":"2411.19626","last_updated":"2025-03-29T03:46:58Z","snapshot_observed_at":"2026-08-12T05:57:13.467211Z","submitted_at":"2024-11-29T11:23:15Z","title":"GREAT: Geometry-Intention Collaborative Inference for Open-Vocabulary 3D Object Affordance Grounding","version":2},"reference_index":54,"source":"pdf_text","source_observed_at":"2026-08-12T06:02:52.725476Z"},"links":{"cited_paper":"/paper/2209.10733","citing_paper":"/paper/2411.19626"},"observation_digest":"sha256:823b9bec52530575d5a440baf2c47846271c68ad98c19978679d18adc0ba9863","observation_id":"6dd19593-0581-4347-badd-15d03d82f310","resolution":{"observed_at":"2026-08-12T06:02:52.861455Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T06:02:53.032310Z","title":"Kptllm: Unveiling the power of large language model for keypoint comprehension,","venue":null,"work_id":"b0cf03e1-6bd8-4122-a8ee-94d75af764cb","year":null},"citing_paper":{"arxiv_id":"2411.19626","last_updated":"2025-03-29T03:46:58Z","snapshot_observed_at":"2026-08-12T05:57:13.467211Z","submitted_at":"2024-11-29T11:23:15Z","title":"GREAT: Geometry-Intention Collaborative Inference for Open-Vocabulary 3D Object Affordance Grounding","version":2},"reference_index":55,"source":"pdf_text","source_observed_at":"2026-08-12T06:02:52.729043Z"},"links":{"citing_paper":"/paper/2411.19626"},"observation_digest":"sha256:3e50ff2aebe7de8fd6cec15905b99a863cd5d44585bcd1f9640e5a936a452212","observation_id":"6aeb180a-3656-4188-ad1f-d20ca94506b7","resolution":{"observed_at":"2026-08-12T06:02:53.035784Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T06:02:53.023129Z","title":"Grounding 3d object affordance from 2d interactions in images","venue":null,"work_id":"b87d3f10-ad7d-4977-88ee-67a40a97ed97","year":2023},"citing_paper":{"arxiv_id":"2411.19626","last_updated":"2025-03-29T03:46:58Z","snapshot_observed_at":"2026-08-12T05:57:13.467211Z","submitted_at":"2024-11-29T11:23:15Z","title":"GREAT: Geometry-Intention Collaborative Inference for Open-Vocabulary 3D Object Affordance Grounding","version":2},"reference_index":56,"source":"pdf_text","source_observed_at":"2026-08-12T06:02:52.732261Z"},"links":{"citing_paper":"/paper/2411.19626"},"observation_digest":"sha256:18f7da1496c3ef3e18360f23d12505e6b30848452a9e0fa7f31bd09efe636bf6","observation_id":"ec536482-afcb-4530-ad95-51de9c4315d3","resolution":{"observed_at":"2026-08-12T06:02:53.026290Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T06:02:53.013922Z","title":"Lemon: Learning 3d human-object in- teraction relation from 2d images","venue":null,"work_id":"00df6ba4-52e3-4167-a45f-ec35c57600bf","year":2024},"citing_paper":{"arxiv_id":"2411.19626","last_updated":"2025-03-29T03:46:58Z","snapshot_observed_at":"2026-08-12T05:57:13.467211Z","submitted_at":"2024-11-29T11:23:15Z","title":"GREAT: Geometry-Intention Collaborative Inference for Open-Vocabulary 3D Object Affordance Grounding","version":2},"reference_index":57,"source":"pdf_text","source_observed_at":"2026-08-12T06:02:52.735476Z"},"links":{"citing_paper":"/paper/2411.19626"},"observation_digest":"sha256:c2d1bfc58c2ab9697f66578eb67694147a3b061c972469dbf71138143a4f5bc6","observation_id":"a742b891-a317-4361-b789-f28e57000dac","resolution":{"observed_at":"2026-08-12T06:02:53.017406Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2405.13659","last_updated":"2024-10-13T05:23:36Z","snapshot_observed_at":"2026-08-04T13:11:16.442173Z","submitted_at":"2024-05-22T14:03:48Z","title":"EgoChoir: Capturing 3D Human-Object Interaction Regions from Egocentric Views","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2405.13659","snapshot_observed_at":"2026-08-12T06:02:52.738390Z","title":"Egochoir: Capturing 3d human-object interaction regions from egocentric views","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2411.19626","last_updated":"2025-03-29T03:46:58Z","snapshot_observed_at":"2026-08-12T05:57:13.467211Z","submitted_at":"2024-11-29T11:23:15Z","title":"GREAT: Geometry-Intention Collaborative Inference for Open-Vocabulary 3D Object Affordance Grounding","version":2},"reference_index":58,"source":"pdf_text","source_observed_at":"2026-08-12T06:02:52.738390Z"},"links":{"cited_paper":"/paper/2405.13659","citing_paper":"/paper/2411.19626"},"observation_digest":"sha256:1441c0b8ea5aacb53684ff3cfa64f5c8cea45aa575e7b15cc5e25d842b0b6315","observation_id":"e2a988fe-7265-41a0-986a-2c0f35c3aef9","resolution":{"observed_at":"2026-08-12T06:02:52.738390Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T06:02:53.004071Z","title":"Griffiths, Yuan Cao, and Karthik Narasimhan","venue":null,"work_id":"a5f525bd-aa74-4493-8e47-db86fdbe18ef","year":2023},"citing_paper":{"arxiv_id":"2411.19626","last_updated":"2025-03-29T03:46:58Z","snapshot_observed_at":"2026-08-12T05:57:13.467211Z","submitted_at":"2024-11-29T11:23:15Z","title":"GREAT: Geometry-Intention Collaborative Inference for Open-Vocabulary 3D Object Affordance Grounding","version":2},"reference_index":59,"source":"pdf_text","source_observed_at":"2026-08-12T06:02:52.742118Z"},"links":{"citing_paper":"/paper/2411.19626"},"observation_digest":"sha256:b3daf4d7c3d634517a930f51933f08a8859950cba83ac2f7b95e62b1ee91b260","observation_id":"8376fb4f-f560-42fc-a3c7-c8944c1cbc83","resolution":{"observed_at":"2026-08-12T06:02:53.007838Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T06:02:52.994903Z","title":"Beyond chain-of- thought, effective graph-of-thought reasoning in language models, 2024","venue":null,"work_id":"7500c0cd-202b-4fe6-855d-3ad3fd5ef0f3","year":2024},"citing_paper":{"arxiv_id":"2411.19626","last_updated":"2025-03-29T03:46:58Z","snapshot_observed_at":"2026-08-12T05:57:13.467211Z","submitted_at":"2024-11-29T11:23:15Z","title":"GREAT: Geometry-Intention Collaborative Inference for Open-Vocabulary 3D Object Affordance Grounding","version":2},"reference_index":60,"source":"pdf_text","source_observed_at":"2026-08-12T06:02:52.745126Z"},"links":{"citing_paper":"/paper/2411.19626"},"observation_digest":"sha256:0bbbad3917efc75747040491b68cfcfffdbcd89d3bc10b93bf9694a531d93e2c","observation_id":"3e6f1565-1cef-4893-a15d-4ef9ea14b3fc","resolution":{"observed_at":"2026-08-12T06:02:52.998080Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2108.03658","last_updated":"2021-08-08T14:53:10Z","snapshot_observed_at":"2026-07-06T11:36:31.146675Z","submitted_at":"2021-08-08T14:53:10Z","title":"One-Shot Object Affordance Detection in the Wild","version":1},"cited_work":{"arxiv_id":"2108.03658","doi":null,"metadata_source":"pith","pith_arxiv_id":"2108.03658","snapshot_observed_at":"2026-08-12T06:02:52.835148Z","title":"One-Shot Object Affordance Detection in the Wild","venue":"cs.CV","work_id":"323847f0-c630-4788-8b3e-8774ba1f1315","year":2021},"citing_paper":{"arxiv_id":"2411.19626","last_updated":"2025-03-29T03:46:58Z","snapshot_observed_at":"2026-08-12T05:57:13.467211Z","submitted_at":"2024-11-29T11:23:15Z","title":"GREAT: Geometry-Intention Collaborative Inference for Open-Vocabulary 3D Object Affordance Grounding","version":2},"reference_index":61,"source":"pdf_text","source_observed_at":"2026-08-12T06:02:52.748018Z"},"links":{"cited_paper":"/paper/2108.03658","citing_paper":"/paper/2411.19626"},"observation_digest":"sha256:b17602604b0bdc310d9e15061c2172208d8b05e7b16b2896928f209e73121e06","observation_id":"ed531688-ad40-49d6-beca-7f088d1eca0c","resolution":{"observed_at":"2026-08-12T06:02:52.838810Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T06:02:52.985985Z","title":"Ex- ploring figure-ground assignment mechanism in perceptual organization","venue":null,"work_id":"1e620b12-2a1a-4727-9dd2-44a280f72f93","year":2022},"citing_paper":{"arxiv_id":"2411.19626","last_updated":"2025-03-29T03:46:58Z","snapshot_observed_at":"2026-08-12T05:57:13.467211Z","submitted_at":"2024-11-29T11:23:15Z","title":"GREAT: Geometry-Intention Collaborative Inference for Open-Vocabulary 3D Object Affordance Grounding","version":2},"reference_index":62,"source":"pdf_text","source_observed_at":"2026-08-12T06:02:52.751192Z"},"links":{"citing_paper":"/paper/2411.19626"},"observation_digest":"sha256:75a825af9e9487d09989d8963837b7180ec91b12ef7681bd1abc17e962065a89","observation_id":"d91ef828-2c9c-45e1-88d6-5a783f15cfac","resolution":{"observed_at":"2026-08-12T06:02:52.989402Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T06:02:52.976445Z","title":"Background activation suppression for weakly supervised object localization and semantic segmen- tation","venue":null,"work_id":"fefb7d5b-52a7-41fe-9b45-32c647cff9fa","year":2023},"citing_paper":{"arxiv_id":"2411.19626","last_updated":"2025-03-29T03:46:58Z","snapshot_observed_at":"2026-08-12T05:57:13.467211Z","submitted_at":"2024-11-29T11:23:15Z","title":"GREAT: Geometry-Intention Collaborative Inference for Open-Vocabulary 3D Object Affordance Grounding","version":2},"reference_index":63,"source":"pdf_text","source_observed_at":"2026-08-12T06:02:52.754216Z"},"links":{"citing_paper":"/paper/2411.19626"},"observation_digest":"sha256:f1ae1a00cf8f61949270967bdfa515298a9afcbc3e97429f23c24e12da2f67ae","observation_id":"e792dda3-7171-46af-a48c-53c6e4fd28e0","resolution":{"observed_at":"2026-08-12T06:02:52.979861Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T06:02:52.967012Z","title":"On exploring multiplicity of prim- itives and attributes for texture recognition in the wild","venue":null,"work_id":"9b102387-4877-40c6-bc34-ec940f24571e","year":2024},"citing_paper":{"arxiv_id":"2411.19626","last_updated":"2025-03-29T03:46:58Z","snapshot_observed_at":"2026-08-12T05:57:13.467211Z","submitted_at":"2024-11-29T11:23:15Z","title":"GREAT: Geometry-Intention Collaborative Inference for Open-Vocabulary 3D Object Affordance Grounding","version":2},"reference_index":64,"source":"pdf_text","source_observed_at":"2026-08-12T06:02:52.757296Z"},"links":{"citing_paper":"/paper/2411.19626"},"observation_digest":"sha256:34a77dfd05b33a1148e75aee519258276f9ffea99e144bce53cd81262a5b4406","observation_id":"c6d9e15f-fb59-46e0-b7eb-6ece1ab73ffc","resolution":{"observed_at":"2026-08-12T06:02:52.970430Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T06:02:52.957340Z","title":"Automatic chain of thought prompting in large language models, 2022","venue":null,"work_id":"72369da6-fdb0-4333-9832-6f2e5749cd5c","year":2022},"citing_paper":{"arxiv_id":"2411.19626","last_updated":"2025-03-29T03:46:58Z","snapshot_observed_at":"2026-08-12T05:57:13.467211Z","submitted_at":"2024-11-29T11:23:15Z","title":"GREAT: Geometry-Intention Collaborative Inference for Open-Vocabulary 3D Object Affordance Grounding","version":2},"reference_index":65,"source":"pdf_text","source_observed_at":"2026-08-12T06:02:52.760328Z"},"links":{"citing_paper":"/paper/2411.19626"},"observation_digest":"sha256:2ebf1c9ebbb124722c6a49ff8158e399a4109f5572c6f403d664e4bc3017247c","observation_id":"e5e8f28a-b4fa-42e5-94a3-682863715c17","resolution":{"observed_at":"2026-08-12T06:02:52.960752Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2405.05552","last_updated":"2024-05-09T05:22:18Z","snapshot_observed_at":"2026-07-06T18:11:57.100591Z","submitted_at":"2024-05-09T05:22:18Z","title":"Bidirectional Progressive Transformer for Interaction Intention Anticipation","version":1},"cited_work":{"arxiv_id":"2405.05552","doi":null,"metadata_source":"pith","pith_arxiv_id":"2405.05552","snapshot_observed_at":"2026-08-12T06:02:52.819571Z","title":"Bidirectional Progressive Transformer for Interaction Intention Anticipation","venue":"cs.CV","work_id":"51f95a77-7be6-419f-bdf4-0ec35f2f9b10","year":2024},"citing_paper":{"arxiv_id":"2411.19626","last_updated":"2025-03-29T03:46:58Z","snapshot_observed_at":"2026-08-12T05:57:13.467211Z","submitted_at":"2024-11-29T11:23:15Z","title":"GREAT: Geometry-Intention Collaborative Inference for Open-Vocabulary 3D Object Affordance Grounding","version":2},"reference_index":66,"source":"pdf_text","source_observed_at":"2026-08-12T06:02:52.763412Z"},"links":{"cited_paper":"/paper/2405.05552","citing_paper":"/paper/2411.19626"},"observation_digest":"sha256:6dfddb868db3df15902f7a1cd13f6fd43db5a97ba5f1287489596fd9c1825fc6","observation_id":"3e6e6ef6-0879-4d4e-8471-8ebfc167fced","resolution":{"observed_at":"2026-08-12T06:02:52.825515Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2407.21510","last_updated":"2024-07-31T10:28:49Z","snapshot_observed_at":"2026-07-06T18:54:58.451463Z","submitted_at":"2024-07-31T10:28:49Z","title":"PEAR: Phrase-Based Hand-Object Interaction Anticipation","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2407.21510","snapshot_observed_at":"2026-08-12T06:02:52.767350Z","title":"Pear: Phrase-based hand-object interaction anticipa- tion","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2411.19626","last_updated":"2025-03-29T03:46:58Z","snapshot_observed_at":"2026-08-12T05:57:13.467211Z","submitted_at":"2024-11-29T11:23:15Z","title":"GREAT: Geometry-Intention Collaborative Inference for Open-Vocabulary 3D Object Affordance Grounding","version":2},"reference_index":67,"source":"pdf_text","source_observed_at":"2026-08-12T06:02:52.767350Z"},"links":{"cited_paper":"/paper/2407.21510","citing_paper":"/paper/2411.19626"},"observation_digest":"sha256:8c3fab3d0920f93df8a8685f85271eaa65a406ae39301c72798f29ad37e4513f","observation_id":"cd619bad-ee74-4e6f-8b29-0b0692d9994a","resolution":{"observed_at":"2026-08-12T06:02:52.767350Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2304.10592","last_updated":"2023-10-02T16:38:35Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2023-04-20T18:25:35Z","title":"MiniGPT-4: Enhancing Vision-Language Understanding with Advanced Large Language Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2304.10592","snapshot_observed_at":"2026-08-12T06:02:52.770915Z","title":"Minigpt-4: Enhancing vision-language understanding with advanced large language models","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2411.19626","last_updated":"2025-03-29T03:46:58Z","snapshot_observed_at":"2026-08-12T05:57:13.467211Z","submitted_at":"2024-11-29T11:23:15Z","title":"GREAT: Geometry-Intention Collaborative Inference for Open-Vocabulary 3D Object Affordance Grounding","version":2},"reference_index":68,"source":"pdf_text","source_observed_at":"2026-08-12T06:02:52.770915Z"},"links":{"cited_paper":"/paper/2304.10592","citing_paper":"/paper/2411.19626"},"observation_digest":"sha256:bf5b9e2a150836fcca4860d29fe4210f56ab554b72ca20ac4fd0fa084a0702c8","observation_id":"1915d70b-c8bc-4dac-af96-d3527c7cdf7a","resolution":{"observed_at":"2026-08-12T06:02:52.770915Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"paper":{"arxiv_id":"2411.19626","last_updated":"2025-03-29T03:46:58Z","latest_version":2,"primary_category":"cs.CV","snapshot_observed_at":"2026-08-12T05:57:13.467211Z","submitted_at":"2024-11-29T11:23:15Z","title":"GREAT: Geometry-Intention Collaborative Inference for Open-Vocabulary 3D Object Affordance Grounding"},"reference_resolution":{"displayed":68,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":20,"verified_exact":3,"verified_fuzzy":45},"total_outbound_references":68},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"thesis":"As of 12 August 2026, this Paper Citation Record lists 68 of 68 outbound references and 3 inbound Pith citation observations for arXiv:2411.19626."}