{"as_of":"2026-08-11T19:37:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:350134a22af0e678cce27656e47eeb05fd973ee4534fb0cfc889324bbcea364f","coverage":[{"denominator":58,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":58,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-10T17:16:30.824612Z","state":"measured"},{"denominator":58,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":58,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-11T06:34:44.6726+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2501.12393/citation-record","integrity":"/paper/2501.12393/integrity","json":"/paper/2501.12393/citation-record.json","paper":"/paper/2501.12393"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T17:16:31.634456Z","title":"Blended latent diffusion","venue":null,"work_id":"5ac8078b-53bd-4f81-8a15-4b8f36017766","year":2023},"citing_paper":{"arxiv_id":"2501.12393","last_updated":"2025-01-21T18:59:59Z","snapshot_observed_at":"2026-08-10T17:09:58.572255Z","submitted_at":"2025-01-21T18:59:59Z","title":"Towards Affordance-Aware Articulation Synthesis for Rigged Objects","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-10T17:16:30.609583Z"},"links":{"citing_paper":"/paper/2501.12393"},"observation_digest":"sha256:c553215ee4954acc0848dc29ff19b6f3ed55dcf830f9d83b2ecd009d1110904b","observation_id":"91fcc500-5456-4e14-95b7-3613ed779ba8","resolution":{"observed_at":"2026-08-10T17:16:31.638076Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T17:16:31.624318Z","title":null,"venue":null,"work_id":"45d93bc5-f150-4e7d-b77b-f4231727131b","year":2024},"citing_paper":{"arxiv_id":"2501.12393","last_updated":"2025-01-21T18:59:59Z","snapshot_observed_at":"2026-08-10T17:09:58.572255Z","submitted_at":"2025-01-21T18:59:59Z","title":"Towards Affordance-Aware Articulation Synthesis for Rigged Objects","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-10T17:16:30.613380Z"},"links":{"citing_paper":"/paper/2501.12393"},"observation_digest":"sha256:98bb8519d380ea75e136effd806aebb62a41ad3776b1549b730c8fd13af9c8e1","observation_id":"e83f6f4d-fd28-4519-a751-0fe06df88f8a","resolution":{"observed_at":"2026-08-10T17:16:31.627532Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2311.15127","last_updated":"2023-11-25T22:28:38Z","snapshot_observed_at":"2026-08-07T21:47:08.589400Z","submitted_at":"2023-11-25T22:28:38Z","title":"Stable Video Diffusion: Scaling Latent Video Diffusion Models to Large Datasets","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2311.15127","snapshot_observed_at":"2026-08-10T17:16:30.616989Z","title":"Stable video diffusion: Scaling latent video diffusion models to large datasets","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2501.12393","last_updated":"2025-01-21T18:59:59Z","snapshot_observed_at":"2026-08-10T17:09:58.572255Z","submitted_at":"2025-01-21T18:59:59Z","title":"Towards Affordance-Aware Articulation Synthesis for Rigged Objects","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-10T17:16:30.616989Z"},"links":{"cited_paper":"/paper/2311.15127","citing_paper":"/paper/2501.12393"},"observation_digest":"sha256:aa0ec6102f077ed5af69c215b4f239e630608c568d10336cd8a1100602fa5fcd","observation_id":"2d1e0bb1-52c4-48dc-a3ae-2d3a57d388ee","resolution":{"observed_at":"2026-08-10T17:16:30.616989Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2312.14154","last_updated":"2023-12-21T18:59:30Z","snapshot_observed_at":"2026-07-06T17:06:45.522731Z","submitted_at":"2023-12-21T18:59:30Z","title":"Virtual Pets: Animatable Animal Generation in 3D Scenes","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2312.14154","snapshot_observed_at":"2026-08-10T17:16:30.621119Z","title":"Virtual Pets: Animatable animal generation in 3d scenes","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2501.12393","last_updated":"2025-01-21T18:59:59Z","snapshot_observed_at":"2026-08-10T17:09:58.572255Z","submitted_at":"2025-01-21T18:59:59Z","title":"Towards Affordance-Aware Articulation Synthesis for Rigged Objects","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-10T17:16:30.621119Z"},"links":{"cited_paper":"/paper/2312.14154","citing_paper":"/paper/2501.12393"},"observation_digest":"sha256:c6def4747de76902a4ed6b5027ebe1c650c7489907b618cac8cf6041ac8de7cf","observation_id":"d329f85b-4a36-44d0-8f87-c5afbd2f14ce","resolution":{"observed_at":"2026-08-10T17:16:30.621119Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2409.20502","last_updated":"2024-09-30T17:02:13Z","snapshot_observed_at":"2026-07-06T19:24:43.745786Z","submitted_at":"2024-09-30T17:02:13Z","title":"COLLAGE: Collaborative Human-Agent Interaction Generation using Hierarchical Latent Diffusion and Language Models","version":1},"cited_work":{"arxiv_id":"2409.20502","doi":null,"metadata_source":"pith","pith_arxiv_id":"2409.20502","snapshot_observed_at":"2026-08-10T17:16:30.939362Z","title":"COLLAGE: Collaborative Human-Agent Interaction Generation using Hierarchical Latent Diffusion and Language Models","venue":"cs.LG","work_id":"4f180924-54bd-4dcc-80a0-c4371b3c85c6","year":2024},"citing_paper":{"arxiv_id":"2501.12393","last_updated":"2025-01-21T18:59:59Z","snapshot_observed_at":"2026-08-10T17:09:58.572255Z","submitted_at":"2025-01-21T18:59:59Z","title":"Towards Affordance-Aware Articulation Synthesis for Rigged Objects","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-10T17:16:30.625229Z"},"links":{"cited_paper":"/paper/2409.20502","citing_paper":"/paper/2501.12393"},"observation_digest":"sha256:0591046f5b7ec3aa08171d84dda1726c1b61f74bd220411a5e88c5651a3e9795","observation_id":"5bada428-a15c-4b18-8296-e3cc47eaa779","resolution":{"observed_at":"2026-08-10T17:16:30.943635Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T17:16:31.614761Z","title":"Demo2vec: Reasoning object affordances from online videos","venue":null,"work_id":"aba2c101-ac3a-45d0-b032-a7b9d3f8c8ae","year":2018},"citing_paper":{"arxiv_id":"2501.12393","last_updated":"2025-01-21T18:59:59Z","snapshot_observed_at":"2026-08-10T17:09:58.572255Z","submitted_at":"2025-01-21T18:59:59Z","title":"Towards Affordance-Aware Articulation Synthesis for Rigged Objects","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-10T17:16:30.629270Z"},"links":{"citing_paper":"/paper/2501.12393"},"observation_digest":"sha256:a335a69fb2c8da884a9889fd05dda1c7cbcca6088e27e4311b4af473945e6664","observation_id":"4b9f377c-d9a8-4048-8cae-9c552d86e731","resolution":{"observed_at":"2026-08-10T17:16:31.618187Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T17:16:31.605459Z","title":"The theory of affordances","venue":null,"work_id":"ee0d7ca0-5658-4e77-8ee7-4b1ccc6cb6fd","year":1977},"citing_paper":{"arxiv_id":"2501.12393","last_updated":"2025-01-21T18:59:59Z","snapshot_observed_at":"2026-08-10T17:09:58.572255Z","submitted_at":"2025-01-21T18:59:59Z","title":"Towards Affordance-Aware Articulation Synthesis for Rigged Objects","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-10T17:16:30.633073Z"},"links":{"citing_paper":"/paper/2501.12393"},"observation_digest":"sha256:602ad22a908599e7e337311bd72bbd38e1ab29e11a97bb95efab58938833c103","observation_id":"874dc61a-4b81-4214-9758-9e851cd0bb18","resolution":{"observed_at":"2026-08-10T17:16:31.608795Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T17:16:31.595490Z","title":"What makes a chair a chair? In IEEE Conference on Computer Vision and Pattern Recognition, 2011","venue":null,"work_id":"0b818693-eff1-4d7b-b34b-6c9a6cc2442a","year":2011},"citing_paper":{"arxiv_id":"2501.12393","last_updated":"2025-01-21T18:59:59Z","snapshot_observed_at":"2026-08-10T17:09:58.572255Z","submitted_at":"2025-01-21T18:59:59Z","title":"Towards Affordance-Aware Articulation Synthesis for Rigged Objects","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-10T17:16:30.636706Z"},"links":{"citing_paper":"/paper/2501.12393"},"observation_digest":"sha256:9fde2a7c018a5505f4b66458ffc718a4026af83efe498bb48f885671e64dfbb0","observation_id":"d694e382-d0cd-4974-b633-71dd9fa6528b","resolution":{"observed_at":"2026-08-10T17:16:31.599095Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T17:16:31.586169Z","title":"Proposal flow: Semantic correspondences from ob- ject proposals","venue":null,"work_id":"8e901134-da36-47be-a26d-21fce4655155","year":2017},"citing_paper":{"arxiv_id":"2501.12393","last_updated":"2025-01-21T18:59:59Z","snapshot_observed_at":"2026-08-10T17:09:58.572255Z","submitted_at":"2025-01-21T18:59:59Z","title":"Towards Affordance-Aware Articulation Synthesis for Rigged Objects","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-10T17:16:30.640117Z"},"links":{"citing_paper":"/paper/2501.12393"},"observation_digest":"sha256:683c8c45368be70601aef64f90af9a2aeb568f88fe193fe46874324d7292b7da","observation_id":"9fa9fee1-c3fe-42ed-b2aa-aac11be820e4","resolution":{"observed_at":"2026-08-10T17:16:31.589668Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T17:16:31.576594Z","title":"Instruct-nerf2nerf: Edit- ing 3d scenes with instructions","venue":null,"work_id":"c44c29c0-e75a-48bd-b8e0-55a6ecdea11c","year":2023},"citing_paper":{"arxiv_id":"2501.12393","last_updated":"2025-01-21T18:59:59Z","snapshot_observed_at":"2026-08-10T17:09:58.572255Z","submitted_at":"2025-01-21T18:59:59Z","title":"Towards Affordance-Aware Articulation Synthesis for Rigged Objects","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-10T17:16:30.643417Z"},"links":{"citing_paper":"/paper/2501.12393"},"observation_digest":"sha256:ac19f984ad16ab114b85b8b4179989bdb531dbe99e6140aed12dcfc67d4e7c47","observation_id":"e49b3a92-ce3b-45d3-ac4f-73818f526364","resolution":{"observed_at":"2026-08-10T17:16:31.580462Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T17:16:31.566490Z","title":"Populating 3d scenes by learning human-scene interaction","venue":null,"work_id":"b7579135-1a72-40d5-87c2-4538c5af788f","year":2021},"citing_paper":{"arxiv_id":"2501.12393","last_updated":"2025-01-21T18:59:59Z","snapshot_observed_at":"2026-08-10T17:09:58.572255Z","submitted_at":"2025-01-21T18:59:59Z","title":"Towards Affordance-Aware Articulation Synthesis for Rigged Objects","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-10T17:16:30.646831Z"},"links":{"citing_paper":"/paper/2501.12393"},"observation_digest":"sha256:2df4cb17f73780acabd13d5e4ac2257a8908fc3b972324a6b42a9f967d20c8ee","observation_id":"af571c33-0b03-43ff-a13f-9742b5ea695b","resolution":{"observed_at":"2026-08-10T17:16:31.569995Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2104.08718","last_updated":"2022-03-23T19:47:21Z","snapshot_observed_at":"2026-07-06T11:01:02.207193Z","submitted_at":"2021-04-18T05:00:29Z","title":"CLIPScore: A Reference-free Evaluation Metric for Image Captioning","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2104.08718","snapshot_observed_at":"2026-08-10T17:16:30.650330Z","title":"Clipscore: A reference-free evaluation met- ric for image captioning","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2501.12393","last_updated":"2025-01-21T18:59:59Z","snapshot_observed_at":"2026-08-10T17:09:58.572255Z","submitted_at":"2025-01-21T18:59:59Z","title":"Towards Affordance-Aware Articulation Synthesis for Rigged Objects","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-10T17:16:30.650330Z"},"links":{"cited_paper":"/paper/2104.08718","citing_paper":"/paper/2501.12393"},"observation_digest":"sha256:267235aabd70dbd8e5ea8d96890a8843e1deb2413930f29274ac225559994f81","observation_id":"95481e98-e255-4fd0-91b4-24087dd29f72","resolution":{"observed_at":"2026-08-10T17:16:30.650330Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T17:16:31.555764Z","title":"Text2room: Extracting textured 3d meshes from 2d text-to-image models","venue":null,"work_id":"585efcc3-f215-45d9-a009-9b540c7cdc22","year":2023},"citing_paper":{"arxiv_id":"2501.12393","last_updated":"2025-01-21T18:59:59Z","snapshot_observed_at":"2026-08-10T17:09:58.572255Z","submitted_at":"2025-01-21T18:59:59Z","title":"Towards Affordance-Aware Articulation Synthesis for Rigged Objects","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-10T17:16:30.654416Z"},"links":{"citing_paper":"/paper/2501.12393"},"observation_digest":"sha256:b22e4b7cee4ebb2a1ddfc13d85c3dee4cb0b06bc3f169bea3db3ea8be8a90244","observation_id":"6a1c84f6-e309-4aac-989b-6613a8a9b9bd","resolution":{"observed_at":"2026-08-10T17:16:31.559913Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T17:16:31.545578Z","title":"Skinning: Real-time shape deformation","venue":null,"work_id":"e3baa2ac-8098-4247-b46e-48dd82c349bd","year":2014},"citing_paper":{"arxiv_id":"2501.12393","last_updated":"2025-01-21T18:59:59Z","snapshot_observed_at":"2026-08-10T17:09:58.572255Z","submitted_at":"2025-01-21T18:59:59Z","title":"Towards Affordance-Aware Articulation Synthesis for Rigged Objects","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-10T17:16:30.658247Z"},"links":{"citing_paper":"/paper/2501.12393"},"observation_digest":"sha256:0ff52b76eb5a28f41d63907786f04fdc2ca9d698890471a6c6a35c2afda27c2b","observation_id":"76c40eef-7b48-4ab4-80c3-b5b7bde8c162","resolution":{"observed_at":"2026-08-10T17:16:31.549470Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T17:16:31.535199Z","title":"Beyond the contact: Discovering comprehensive affordance for 3d objects from pre-trained 2d diffusion models","venue":null,"work_id":"b188c20d-f283-48bc-aa4d-2ce4903e8b3f","year":2024},"citing_paper":{"arxiv_id":"2501.12393","last_updated":"2025-01-21T18:59:59Z","snapshot_observed_at":"2026-08-10T17:09:58.572255Z","submitted_at":"2025-01-21T18:59:59Z","title":"Towards Affordance-Aware Articulation Synthesis for Rigged Objects","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-10T17:16:30.661317Z"},"links":{"citing_paper":"/paper/2501.12393"},"observation_digest":"sha256:3a9fa1c2d0330dbb0769a8b7fb3851a603ff9ac9f12fd8447388ec247c068ba3","observation_id":"17996e91-0d72-4b11-bcad-7c9c485c9cb9","resolution":{"observed_at":"2026-08-10T17:16:31.538834Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T17:16:31.526056Z","title":"Eschernet: A generative model for scalable view synthesis","venue":null,"work_id":"68eac525-f3f9-4907-830e-891b5ebb3d51","year":2024},"citing_paper":{"arxiv_id":"2501.12393","last_updated":"2025-01-21T18:59:59Z","snapshot_observed_at":"2026-08-10T17:09:58.572255Z","submitted_at":"2025-01-21T18:59:59Z","title":"Towards Affordance-Aware Articulation Synthesis for Rigged Objects","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-10T17:16:30.664834Z"},"links":{"citing_paper":"/paper/2501.12393"},"observation_digest":"sha256:bc06d61d4e1862134946e335184b9ff4d0be2551f927ff596929ed3963f21d10","observation_id":"94a9cf9d-ca81-4b60-bb01-eab2ed2c7f1d","resolution":{"observed_at":"2026-08-10T17:16:31.529553Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T17:16:31.516841Z","title":"Physically grounded spatio-temporal object affordances","venue":null,"work_id":"f9c3410e-69fd-4fd7-88fd-78a41cc4a66e","year":2014},"citing_paper":{"arxiv_id":"2501.12393","last_updated":"2025-01-21T18:59:59Z","snapshot_observed_at":"2026-08-10T17:09:58.572255Z","submitted_at":"2025-01-21T18:59:59Z","title":"Towards Affordance-Aware Articulation Synthesis for Rigged Objects","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-10T17:16:30.668285Z"},"links":{"citing_paper":"/paper/2501.12393"},"observation_digest":"sha256:63812fbcf5f3d030e37587127caf11584821d35290e58c082f0f314632404e2e","observation_id":"74e56739-39be-4a7f-9150-b5ea0d21bf7a","resolution":{"observed_at":"2026-08-10T17:16:31.520270Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T17:16:31.507367Z","title":"Putting people in their place: Affordance-aware hu- man insertion into scenes","venue":null,"work_id":"c6adab60-9462-42e6-8af2-c83b3a015a9b","year":2023},"citing_paper":{"arxiv_id":"2501.12393","last_updated":"2025-01-21T18:59:59Z","snapshot_observed_at":"2026-08-10T17:09:58.572255Z","submitted_at":"2025-01-21T18:59:59Z","title":"Towards Affordance-Aware Articulation Synthesis for Rigged Objects","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-10T17:16:30.671682Z"},"links":{"citing_paper":"/paper/2501.12393"},"observation_digest":"sha256:f7c9ac6e7e713a9822284bad76afb2c27460a2566f1effae6ec5cf73065b9fe6","observation_id":"7e61b5de-57d0-4681-a0eb-f0679b1727ed","resolution":{"observed_at":"2026-08-10T17:16:31.511041Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T17:16:31.497850Z","title":"Flux, 2024","venue":null,"work_id":"5f54caef-72d9-4002-a517-d49fbcdf0188","year":2024},"citing_paper":{"arxiv_id":"2501.12393","last_updated":"2025-01-21T18:59:59Z","snapshot_observed_at":"2026-08-10T17:09:58.572255Z","submitted_at":"2025-01-21T18:59:59Z","title":"Towards Affordance-Aware Articulation Synthesis for Rigged Objects","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-10T17:16:30.674923Z"},"links":{"citing_paper":"/paper/2501.12393"},"observation_digest":"sha256:87be41f0b86015c92d784008efff8745b2a4b22a45444657e0ac37774a9ab247","observation_id":"69e58ca3-af69-4512-829b-e979c92e99ca","resolution":{"observed_at":"2026-08-10T17:16:31.501596Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T17:16:31.487519Z","title":"One-shot open affordance learning with foundation models","venue":null,"work_id":"c872abac-0daa-4b54-a04e-050c380a40e1","year":2024},"citing_paper":{"arxiv_id":"2501.12393","last_updated":"2025-01-21T18:59:59Z","snapshot_observed_at":"2026-08-10T17:09:58.572255Z","submitted_at":"2025-01-21T18:59:59Z","title":"Towards Affordance-Aware Articulation Synthesis for Rigged Objects","version":1},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-10T17:16:30.677990Z"},"links":{"citing_paper":"/paper/2501.12393"},"observation_digest":"sha256:9acabe62cbc2c0028990b76978ae0a7ee293e631f9a0479c72ae28a2f893e3cc","observation_id":"7da46757-19c5-4161-8c6d-1868905f8072","resolution":{"observed_at":"2026-08-10T17:16:31.491105Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T17:16:31.477492Z","title":"Genzi: Zero-shot 3d human-scene interaction generation","venue":null,"work_id":"7fa1fdb3-7d8d-40b0-acdf-76ec1e505d73","year":2024},"citing_paper":{"arxiv_id":"2501.12393","last_updated":"2025-01-21T18:59:59Z","snapshot_observed_at":"2026-08-10T17:09:58.572255Z","submitted_at":"2025-01-21T18:59:59Z","title":"Towards Affordance-Aware Articulation Synthesis for Rigged Objects","version":1},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-10T17:16:30.681887Z"},"links":{"citing_paper":"/paper/2501.12393"},"observation_digest":"sha256:c048272b522d277beb4fa71ed84529be145512082be551e6e34633c4dde230ca","observation_id":"8bc82fb7-54a3-46b6-b65d-f5a5581499e8","resolution":{"observed_at":"2026-08-10T17:16:31.481078Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T17:16:31.467402Z","title":"Putting humans in a scene: Learning affordance in 3d indoor environments","venue":null,"work_id":"447b30f1-0efb-4b6d-b317-e16254bbf100","year":null},"citing_paper":{"arxiv_id":"2501.12393","last_updated":"2025-01-21T18:59:59Z","snapshot_observed_at":"2026-08-10T17:09:58.572255Z","submitted_at":"2025-01-21T18:59:59Z","title":"Towards Affordance-Aware Articulation Synthesis for Rigged Objects","version":1},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-10T17:16:30.685295Z"},"links":{"citing_paper":"/paper/2501.12393"},"observation_digest":"sha256:34785e7f840ccbc729461bdc18154b91323d7f05901a7a616f36b52ae0f1a1d7","observation_id":"070951d3-5285-4ce9-a465-b1c14f8ddea0","resolution":{"observed_at":"2026-08-10T17:16:31.470967Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T17:16:31.456973Z","title":"Magic3d: High-resolution text-to-3d content creation","venue":null,"work_id":"ca95436e-864f-4519-8403-98799aee5936","year":2023},"citing_paper":{"arxiv_id":"2501.12393","last_updated":"2025-01-21T18:59:59Z","snapshot_observed_at":"2026-08-10T17:09:58.572255Z","submitted_at":"2025-01-21T18:59:59Z","title":"Towards Affordance-Aware Articulation Synthesis for Rigged Objects","version":1},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-10T17:16:30.689236Z"},"links":{"citing_paper":"/paper/2501.12393"},"observation_digest":"sha256:6ef9b456a49bc481d10c0d17b26776fe65d1c35900f5be8f4d5d2ea860c0b363","observation_id":"27080cd3-5d0f-4b2c-85e6-4cd08ee0ab67","resolution":{"observed_at":"2026-08-10T17:16:31.460858Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T17:16:31.328352Z","title":"Align your gaussians: Text-to-4d with dynamic 3d gaussians and composed diffusion models","venue":null,"work_id":"c3236080-a054-447d-93c0-23f3e8484dbb","year":2024},"citing_paper":{"arxiv_id":"2501.12393","last_updated":"2025-01-21T18:59:59Z","snapshot_observed_at":"2026-08-10T17:09:58.572255Z","submitted_at":"2025-01-21T18:59:59Z","title":"Towards Affordance-Aware Articulation Synthesis for Rigged Objects","version":1},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-10T17:16:30.692658Z"},"links":{"citing_paper":"/paper/2501.12393"},"observation_digest":"sha256:5144bb4d911bacc1704df1d9a3bbda3377a4846bd86df404d62a65cdd9f77c58","observation_id":"afe98261-05d7-48dc-b9bf-466432345aba","resolution":{"observed_at":"2026-08-10T17:16:31.448928Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T17:16:31.316258Z","title":"Zero-1-to-3: Zero-shot one image to 3d object","venue":null,"work_id":"7a3eae58-0798-4053-bf23-7e37da4a01ae","year":2023},"citing_paper":{"arxiv_id":"2501.12393","last_updated":"2025-01-21T18:59:59Z","snapshot_observed_at":"2026-08-10T17:09:58.572255Z","submitted_at":"2025-01-21T18:59:59Z","title":"Towards Affordance-Aware Articulation Synthesis for Rigged Objects","version":1},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-08-10T17:16:30.695971Z"},"links":{"citing_paper":"/paper/2501.12393"},"observation_digest":"sha256:692dfe5d249f4f11e74a9ce31b5ee5cf8246feab133cc9640c3e3dc95391947d","observation_id":"340c188e-53f5-4a14-a2d5-a8219147efc1","resolution":{"observed_at":"2026-08-10T17:16:31.320352Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T17:16:31.304215Z","title":"Syncdreamer: Gen- 9 erating multiview-consistent images from a single-view im- age","venue":null,"work_id":"28c82010-71d8-480c-bf9b-a04916aef28c","year":2023},"citing_paper":{"arxiv_id":"2501.12393","last_updated":"2025-01-21T18:59:59Z","snapshot_observed_at":"2026-08-10T17:09:58.572255Z","submitted_at":"2025-01-21T18:59:59Z","title":"Towards Affordance-Aware Articulation Synthesis for Rigged Objects","version":1},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-08-10T17:16:30.699224Z"},"links":{"citing_paper":"/paper/2501.12393"},"observation_digest":"sha256:a4ebeba7fae87ed81b6c79a3025bbc5369def6d06f19bfef22b664ccdda42407","observation_id":"c87721b4-cb12-4df0-9ac3-5cd6df02e062","resolution":{"observed_at":"2026-08-10T17:16:31.308362Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T17:16:31.291258Z","title":"Learning affor- dance landscapes for interaction exploration in 3d environ- ments","venue":null,"work_id":"0839cb39-37a3-4a24-986b-d0eaed8549e7","year":2020},"citing_paper":{"arxiv_id":"2501.12393","last_updated":"2025-01-21T18:59:59Z","snapshot_observed_at":"2026-08-10T17:09:58.572255Z","submitted_at":"2025-01-21T18:59:59Z","title":"Towards Affordance-Aware Articulation Synthesis for Rigged Objects","version":1},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-08-10T17:16:30.702647Z"},"links":{"citing_paper":"/paper/2501.12393"},"observation_digest":"sha256:111e1dc4698d007cb91b5ad1b960a1ab5d5e1ba8bd20f7e848ec078654b33f6c","observation_id":"daaa7084-b8eb-4483-ba7b-b56a4fdc514a","resolution":{"observed_at":"2026-08-10T17:16:31.295284Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T17:16:31.280219Z","title":"Grounded human-object interaction hotspots from video","venue":null,"work_id":"e9766c9b-5c9b-4119-8f88-31c507bd8beb","year":2019},"citing_paper":{"arxiv_id":"2501.12393","last_updated":"2025-01-21T18:59:59Z","snapshot_observed_at":"2026-08-10T17:09:58.572255Z","submitted_at":"2025-01-21T18:59:59Z","title":"Towards Affordance-Aware Articulation Synthesis for Rigged Objects","version":1},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-08-10T17:16:30.707910Z"},"links":{"citing_paper":"/paper/2501.12393"},"observation_digest":"sha256:5e00397649502d92c4e15e1972c0b22cc88ed7a60ed6abe9ac34a7bf49143411","observation_id":"7629d9a6-c8f5-4b0e-82a3-db0e19eae725","resolution":{"observed_at":"2026-08-10T17:16:31.283983Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T17:16:31.269664Z","title":"Chatgpt, 2024","venue":null,"work_id":"efa94106-e163-4945-b972-9ccac2de80ba","year":2024},"citing_paper":{"arxiv_id":"2501.12393","last_updated":"2025-01-21T18:59:59Z","snapshot_observed_at":"2026-08-10T17:09:58.572255Z","submitted_at":"2025-01-21T18:59:59Z","title":"Towards Affordance-Aware Articulation Synthesis for Rigged Objects","version":1},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-08-10T17:16:30.711944Z"},"links":{"citing_paper":"/paper/2501.12393"},"observation_digest":"sha256:9d153b612d7eb1a4d1b4ad93aaf98a8517b96611533e24f52ed3c08a1fd5e72d","observation_id":"1dc59423-9316-4ccb-a6ef-5d64545acef2","resolution":{"observed_at":"2026-08-10T17:16:31.273268Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T17:16:31.258535Z","title":"Pytorch: An imperative style, high-performance deep learning library","venue":null,"work_id":"bd4b2283-245f-434a-8050-0dffdb3d3b0c","year":2019},"citing_paper":{"arxiv_id":"2501.12393","last_updated":"2025-01-21T18:59:59Z","snapshot_observed_at":"2026-08-10T17:09:58.572255Z","submitted_at":"2025-01-21T18:59:59Z","title":"Towards Affordance-Aware Articulation Synthesis for Rigged Objects","version":1},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-08-10T17:16:30.715618Z"},"links":{"citing_paper":"/paper/2501.12393"},"observation_digest":"sha256:80cd3837e374f14d56af38ca8427d36447e501f91ec993f1f409fd1b2bf2f910","observation_id":"dca590b1-1e52-4801-bf86-1d6eac40db16","resolution":{"observed_at":"2026-08-10T17:16:31.262164Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T17:16:31.247747Z","title":"Expressive body capture: 3d hands, face, and body from a single image","venue":null,"work_id":"35365efc-f2f7-4932-a354-8b1eb2db622a","year":2019},"citing_paper":{"arxiv_id":"2501.12393","last_updated":"2025-01-21T18:59:59Z","snapshot_observed_at":"2026-08-10T17:09:58.572255Z","submitted_at":"2025-01-21T18:59:59Z","title":"Towards Affordance-Aware Articulation Synthesis for Rigged Objects","version":1},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-08-10T17:16:30.719214Z"},"links":{"citing_paper":"/paper/2501.12393"},"observation_digest":"sha256:996b9331f33163e19555333b4c7ba8d1b5533e30e7a497660e42dfa8a8fd0766","observation_id":"883e5cae-ebde-4352-91de-4709ee12b060","resolution":{"observed_at":"2026-08-10T17:16:31.251665Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T17:16:31.235343Z","title":"Dreamfusion: Text-to-3d using 2d diffusion","venue":null,"work_id":"c78b24a0-12cf-4fb1-92d7-9d18962d5d61","year":2023},"citing_paper":{"arxiv_id":"2501.12393","last_updated":"2025-01-21T18:59:59Z","snapshot_observed_at":"2026-08-10T17:09:58.572255Z","submitted_at":"2025-01-21T18:59:59Z","title":"Towards Affordance-Aware Articulation Synthesis for Rigged Objects","version":1},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-08-10T17:16:30.723283Z"},"links":{"citing_paper":"/paper/2501.12393"},"observation_digest":"sha256:36131073d4945d7d0afe9716c99403b96637bb13891c965504086ba37e335a94","observation_id":"5a34a596-e542-405b-9669-be1cdbe4c0b3","resolution":{"observed_at":"2026-08-10T17:16:31.239811Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T17:16:30.727300Z","title":"Learn- ing transferable visual models from natural language super- vision","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2501.12393","last_updated":"2025-01-21T18:59:59Z","snapshot_observed_at":"2026-08-10T17:09:58.572255Z","submitted_at":"2025-01-21T18:59:59Z","title":"Towards Affordance-Aware Articulation Synthesis for Rigged Objects","version":1},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-08-10T17:16:30.727300Z"},"links":{"citing_paper":"/paper/2501.12393"},"observation_digest":"sha256:3e4c8b99f58b193cedf02da0d5fa44e39e82057d6e3760e927dd43c23cfcdb00","observation_id":"e942c6ba-af4d-4a1b-a911-95bfae7e322e","resolution":{"observed_at":"2026-08-10T17:16:30.727300Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T17:16:31.215639Z","title":"Dreambooth3d: Subject-driven text-to-3d generation","venue":null,"work_id":"acb9fa1b-bd59-422b-ad79-9b242934c28b","year":2023},"citing_paper":{"arxiv_id":"2501.12393","last_updated":"2025-01-21T18:59:59Z","snapshot_observed_at":"2026-08-10T17:09:58.572255Z","submitted_at":"2025-01-21T18:59:59Z","title":"Towards Affordance-Aware Articulation Synthesis for Rigged Objects","version":1},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-08-10T17:16:30.731218Z"},"links":{"citing_paper":"/paper/2501.12393"},"observation_digest":"sha256:0e09ab3a1b4563c6f669f1f1fea6f85a7156ef71ee1b5f77d3f32b23bc4ec601","observation_id":"f2b41523-ab5b-4d99-9cf4-8fdffe0b36ee","resolution":{"observed_at":"2026-08-10T17:16:31.219732Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2007.08501","last_updated":"2020-07-16T17:53:02Z","snapshot_observed_at":"2026-07-06T09:38:53.228850Z","submitted_at":"2020-07-16T17:53:02Z","title":"Accelerating 3D Deep Learning with PyTorch3D","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2007.08501","snapshot_observed_at":"2026-08-10T17:16:30.735006Z","title":"Accelerating 3d deep learning with pytorch3d","venue":null,"work_id":null,"year":2007},"citing_paper":{"arxiv_id":"2501.12393","last_updated":"2025-01-21T18:59:59Z","snapshot_observed_at":"2026-08-10T17:09:58.572255Z","submitted_at":"2025-01-21T18:59:59Z","title":"Towards Affordance-Aware Articulation Synthesis for Rigged Objects","version":1},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-08-10T17:16:30.735006Z"},"links":{"cited_paper":"/paper/2007.08501","citing_paper":"/paper/2501.12393"},"observation_digest":"sha256:96b776eb25ea1f47db8a6ea7e978640124c00edef9413088416032fa38af15c7","observation_id":"326f5d13-8b20-48e2-b6aa-bf82c25787ed","resolution":{"observed_at":"2026-08-10T17:16:30.735006Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T17:16:31.203182Z","title":"High-resolution image syn- thesis with latent diffusion models","venue":null,"work_id":"4446fdf6-e585-4f21-a430-4c1fda16853a","year":2022},"citing_paper":{"arxiv_id":"2501.12393","last_updated":"2025-01-21T18:59:59Z","snapshot_observed_at":"2026-08-10T17:09:58.572255Z","submitted_at":"2025-01-21T18:59:59Z","title":"Towards Affordance-Aware Articulation Synthesis for Rigged Objects","version":1},"reference_index":36,"source":"pdf_text","source_observed_at":"2026-08-10T17:16:30.739603Z"},"links":{"citing_paper":"/paper/2501.12393"},"observation_digest":"sha256:805717697824accdeda430f894809041815c3fc3b6ea3c3582a7f03b55fcfcad","observation_id":"63c27240-9a17-47fb-b19c-76d67c796538","resolution":{"observed_at":"2026-08-10T17:16:31.207286Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T17:16:31.191192Z","title":"Laion-5b: An open large-scale dataset for training next generation image-text models","venue":null,"work_id":"f83a49d2-7635-4f4a-8e27-b300da316dbe","year":2022},"citing_paper":{"arxiv_id":"2501.12393","last_updated":"2025-01-21T18:59:59Z","snapshot_observed_at":"2026-08-10T17:09:58.572255Z","submitted_at":"2025-01-21T18:59:59Z","title":"Towards Affordance-Aware Articulation Synthesis for Rigged Objects","version":1},"reference_index":37,"source":"pdf_text","source_observed_at":"2026-08-10T17:16:30.743640Z"},"links":{"citing_paper":"/paper/2501.12393"},"observation_digest":"sha256:fc112894e6806084fd1b8381d206b4b58bdb3770dd883f72738eca999583bbe1","observation_id":"90858e88-cb2c-49ce-bc58-5c9d056c6a99","resolution":{"observed_at":"2026-08-10T17:16:31.195273Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2404.07199","last_updated":"2025-03-11T17:06:18Z","snapshot_observed_at":"2026-08-08T01:47:51.398413Z","submitted_at":"2024-04-10T17:57:41Z","title":"RealmDreamer: Text-Driven 3D Scene Generation with Inpainting and Depth Diffusion","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2404.07199","snapshot_observed_at":"2026-08-10T17:16:30.747533Z","title":"Realmdreamer: Text-driven 3d scene gener- ation with inpainting and depth diffusion","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2501.12393","last_updated":"2025-01-21T18:59:59Z","snapshot_observed_at":"2026-08-10T17:09:58.572255Z","submitted_at":"2025-01-21T18:59:59Z","title":"Towards Affordance-Aware Articulation Synthesis for Rigged Objects","version":1},"reference_index":38,"source":"pdf_text","source_observed_at":"2026-08-10T17:16:30.747533Z"},"links":{"cited_paper":"/paper/2404.07199","citing_paper":"/paper/2501.12393"},"observation_digest":"sha256:642b325a645a30c69d43e6af964ab6ea681ce9692383de87534904e5d068dece","observation_id":"b12e0969-cd01-468e-b051-7327594975a9","resolution":{"observed_at":"2026-08-10T17:16:30.747533Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T17:16:31.178406Z","title":"Stable-dreamfusion: Text-to-3d with stable-diffusion, 2022","venue":null,"work_id":"f5df5258-806b-4d86-b5c7-1e985f8d3138","year":2022},"citing_paper":{"arxiv_id":"2501.12393","last_updated":"2025-01-21T18:59:59Z","snapshot_observed_at":"2026-08-10T17:09:58.572255Z","submitted_at":"2025-01-21T18:59:59Z","title":"Towards Affordance-Aware Articulation Synthesis for Rigged Objects","version":1},"reference_index":39,"source":"pdf_text","source_observed_at":"2026-08-10T17:16:30.751508Z"},"links":{"citing_paper":"/paper/2501.12393"},"observation_digest":"sha256:367fbbffc8c61b75d3b6ab8a07076b715bba661c1375f1c847db31c9d69b50c9","observation_id":"44823208-8d74-4a71-8bd4-6ff5df85584f","resolution":{"observed_at":"2026-08-10T17:16:31.182287Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T17:16:31.165654Z","title":"Flux-controlnet-inpainting, 2024","venue":null,"work_id":"a652e59f-e3a6-4cc8-a6a3-ddc788400168","year":2024},"citing_paper":{"arxiv_id":"2501.12393","last_updated":"2025-01-21T18:59:59Z","snapshot_observed_at":"2026-08-10T17:09:58.572255Z","submitted_at":"2025-01-21T18:59:59Z","title":"Towards Affordance-Aware Articulation Synthesis for Rigged Objects","version":1},"reference_index":40,"source":"pdf_text","source_observed_at":"2026-08-10T17:16:30.755169Z"},"links":{"citing_paper":"/paper/2501.12393"},"observation_digest":"sha256:50800aab81e80ea98fdbb7de9efc78a36c519ecccc05cb0bd49e648309c48fc6","observation_id":"86f61a2e-68af-48d0-b000-556ae1a0b451","resolution":{"observed_at":"2026-08-10T17:16:31.170219Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T17:16:31.153904Z","title":"Synthesizing long-term 3d human motion and interaction in 3d scenes","venue":null,"work_id":"a947badd-1920-4a96-add3-476b85d0253d","year":2021},"citing_paper":{"arxiv_id":"2501.12393","last_updated":"2025-01-21T18:59:59Z","snapshot_observed_at":"2026-08-10T17:09:58.572255Z","submitted_at":"2025-01-21T18:59:59Z","title":"Towards Affordance-Aware Articulation Synthesis for Rigged Objects","version":1},"reference_index":41,"source":"pdf_text","source_observed_at":"2026-08-10T17:16:30.758821Z"},"links":{"citing_paper":"/paper/2501.12393"},"observation_digest":"sha256:e51709c0e98e6202e8fc3c5c4cc2271a6c5c8e6105854c8da00ed2b1461f1aa1","observation_id":"41b66d47-f7f4-40f8-a866-745a8cbf057c","resolution":{"observed_at":"2026-08-10T17:16:31.157944Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T17:16:31.141029Z","title":"Scene- aware generative network for human motion synthesis","venue":null,"work_id":"dfb7c59c-4cdd-4e21-92d1-c20992630aee","year":2021},"citing_paper":{"arxiv_id":"2501.12393","last_updated":"2025-01-21T18:59:59Z","snapshot_observed_at":"2026-08-10T17:09:58.572255Z","submitted_at":"2025-01-21T18:59:59Z","title":"Towards Affordance-Aware Articulation Synthesis for Rigged Objects","version":1},"reference_index":42,"source":"pdf_text","source_observed_at":"2026-08-10T17:16:30.762818Z"},"links":{"citing_paper":"/paper/2501.12393"},"observation_digest":"sha256:ae3435bd1f1504e7ed08363ea2cfafa14d8e4398b3bac0571c4dcf46e1e57a1d","observation_id":"0aa3c326-0134-48e7-a290-b5287f0accfc","resolution":{"observed_at":"2026-08-10T17:16:31.145234Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T17:16:31.129257Z","title":"Binge watching: Scaling affordance learning from sitcoms","venue":null,"work_id":"f2f3d2dc-c4a8-4d36-bca9-0e0750eaab7b","year":2017},"citing_paper":{"arxiv_id":"2501.12393","last_updated":"2025-01-21T18:59:59Z","snapshot_observed_at":"2026-08-10T17:09:58.572255Z","submitted_at":"2025-01-21T18:59:59Z","title":"Towards Affordance-Aware Articulation Synthesis for Rigged Objects","version":1},"reference_index":43,"source":"pdf_text","source_observed_at":"2026-08-10T17:16:30.766346Z"},"links":{"citing_paper":"/paper/2501.12393"},"observation_digest":"sha256:6ad2485dd0b9e5790443bcacce9297cca619d55fd8975ddbbb6ec9ca83aaa5d3","observation_id":"c5900de6-5b28-4af6-984e-d045efe3f0c5","resolution":{"observed_at":"2026-08-10T17:16:31.133297Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T17:16:31.117052Z","title":"Humanise: Language-conditioned hu- man motion generation in 3d scenes","venue":null,"work_id":"47ea1f2a-65e3-4025-9811-2122f39d7915","year":2022},"citing_paper":{"arxiv_id":"2501.12393","last_updated":"2025-01-21T18:59:59Z","snapshot_observed_at":"2026-08-10T17:09:58.572255Z","submitted_at":"2025-01-21T18:59:59Z","title":"Towards Affordance-Aware Articulation Synthesis for Rigged Objects","version":1},"reference_index":44,"source":"pdf_text","source_observed_at":"2026-08-10T17:16:30.770111Z"},"links":{"citing_paper":"/paper/2501.12393"},"observation_digest":"sha256:fac629b0602dc8fc332a228fca9ad71ec99f0dc647e84ee6e3734eef856000e2","observation_id":"8e047e32-3bc9-4779-b396-8ca0d7fea0de","resolution":{"observed_at":"2026-08-10T17:16:31.121111Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T17:16:31.104548Z","title":"Nerfiller: Completing scenes via generative 3d inpainting","venue":null,"work_id":"de09e11b-9bcc-4a88-894d-bb401f6b5f30","year":2024},"citing_paper":{"arxiv_id":"2501.12393","last_updated":"2025-01-21T18:59:59Z","snapshot_observed_at":"2026-08-10T17:09:58.572255Z","submitted_at":"2025-01-21T18:59:59Z","title":"Towards Affordance-Aware Articulation Synthesis for Rigged Objects","version":1},"reference_index":45,"source":"pdf_text","source_observed_at":"2026-08-10T17:16:30.774865Z"},"links":{"citing_paper":"/paper/2501.12393"},"observation_digest":"sha256:fe3a31840e9af4d13e44318cdf4e6a8c61cf3ac181e78d8279823b2225db2341","observation_id":"9429d505-2e24-4be1-8020-36aa38239991","resolution":{"observed_at":"2026-08-10T17:16:31.108860Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T17:16:31.092090Z","title":"Unified human-scene interaction via prompted chain-of-contacts","venue":null,"work_id":"831a9e05-4fa7-44e4-b881-b458e1da52b6","year":null},"citing_paper":{"arxiv_id":"2501.12393","last_updated":"2025-01-21T18:59:59Z","snapshot_observed_at":"2026-08-10T17:09:58.572255Z","submitted_at":"2025-01-21T18:59:59Z","title":"Towards Affordance-Aware Articulation Synthesis for Rigged Objects","version":1},"reference_index":46,"source":"pdf_text","source_observed_at":"2026-08-10T17:16:30.778609Z"},"links":{"citing_paper":"/paper/2501.12393"},"observation_digest":"sha256:dff532e858c511b95e94ae7499fe6f6e016e75698392ca8c6113933414d1bba8","observation_id":"e4827a6e-04f6-4792-8a34-065dea1f961c","resolution":{"observed_at":"2026-08-10T17:16:31.096305Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T17:16:31.080462Z","title":"Interdreamer: Zero-shot text to 3d dynamic human-object in- teraction","venue":null,"work_id":"40233892-e46c-45de-91b5-def13649799a","year":2024},"citing_paper":{"arxiv_id":"2501.12393","last_updated":"2025-01-21T18:59:59Z","snapshot_observed_at":"2026-08-10T17:09:58.572255Z","submitted_at":"2025-01-21T18:59:59Z","title":"Towards Affordance-Aware Articulation Synthesis for Rigged Objects","version":1},"reference_index":47,"source":"pdf_text","source_observed_at":"2026-08-10T17:16:30.782383Z"},"links":{"citing_paper":"/paper/2501.12393"},"observation_digest":"sha256:4b465e7b1244270d32b885de9ef5c44eda84df31436f2cefdd190bb6727ace4f","observation_id":"2fddb5d1-5357-408b-b897-028ff71bdb16","resolution":{"observed_at":"2026-08-10T17:16:31.084213Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2410.16259","last_updated":"2024-10-21T17:57:50Z","snapshot_observed_at":"2026-07-06T19:37:16.203681Z","submitted_at":"2024-10-21T17:57:50Z","title":"Agent-to-Sim: Learning Interactive Behavior Models from Casual Longitudinal Videos","version":1},"cited_work":{"arxiv_id":"2410.16259","doi":null,"metadata_source":"pith","pith_arxiv_id":"2410.16259","snapshot_observed_at":"2026-08-10T17:16:30.883437Z","title":"Agent-to-Sim: Learning Interactive Behavior Models from Casual Longitudinal Videos","venue":"cs.CV","work_id":"d2c3f8c9-f770-43bb-93a3-becadd1af630","year":2024},"citing_paper":{"arxiv_id":"2501.12393","last_updated":"2025-01-21T18:59:59Z","snapshot_observed_at":"2026-08-10T17:09:58.572255Z","submitted_at":"2025-01-21T18:59:59Z","title":"Towards Affordance-Aware Articulation Synthesis for Rigged Objects","version":1},"reference_index":48,"source":"pdf_text","source_observed_at":"2026-08-10T17:16:30.786353Z"},"links":{"cited_paper":"/paper/2410.16259","citing_paper":"/paper/2501.12393"},"observation_digest":"sha256:db2a82c290290b5ee758d6000fe9ebbd0b8597241390e356a95c82827a5ddcb3","observation_id":"9fcd948d-07c3-4213-98b3-59fb21c5b2e4","resolution":{"observed_at":"2026-08-10T17:16:30.890350Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2408.06072","last_updated":"2025-03-26T08:33:10Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-08-12T11:47:11Z","title":"CogVideoX: Text-to-Video Diffusion Models with An Expert Transformer","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2408.06072","snapshot_observed_at":"2026-08-10T17:16:30.790153Z","title":"Cogvideox: Text-to-video diffusion models with an expert transformer","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2501.12393","last_updated":"2025-01-21T18:59:59Z","snapshot_observed_at":"2026-08-10T17:09:58.572255Z","submitted_at":"2025-01-21T18:59:59Z","title":"Towards Affordance-Aware Articulation Synthesis for Rigged Objects","version":1},"reference_index":49,"source":"pdf_text","source_observed_at":"2026-08-10T17:16:30.790153Z"},"links":{"cited_paper":"/paper/2408.06072","citing_paper":"/paper/2501.12393"},"observation_digest":"sha256:211fc03df3f82f88d3c506ee6047ffd1a37357057c0ecc81c9fa9af4560f8d94","observation_id":"52e7ffb5-e05f-4423-871b-01b22c42b403","resolution":{"observed_at":"2026-08-10T17:16:30.790153Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T17:16:31.067350Z","title":"Telling left from right: Identifying geometry-aware semantic corre- spondence","venue":null,"work_id":"62986c31-def7-431c-a4fc-762436209f35","year":2024},"citing_paper":{"arxiv_id":"2501.12393","last_updated":"2025-01-21T18:59:59Z","snapshot_observed_at":"2026-08-10T17:09:58.572255Z","submitted_at":"2025-01-21T18:59:59Z","title":"Towards Affordance-Aware Articulation Synthesis for Rigged Objects","version":1},"reference_index":50,"source":"pdf_text","source_observed_at":"2026-08-10T17:16:30.795139Z"},"links":{"citing_paper":"/paper/2501.12393"},"observation_digest":"sha256:602ece6360cfd0da56b6568c5bd8b463aa3a8cbfaf03fe495d536f55e2646ff7","observation_id":"aab021f5-589d-437c-a89b-c821e1e3a2a4","resolution":{"observed_at":"2026-08-10T17:16:31.072393Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T17:16:31.054571Z","title":"Towards text-guided 3d scene composition","venue":null,"work_id":"ff519fdd-e1cb-48a2-9ec7-e0e6b09e5620","year":2024},"citing_paper":{"arxiv_id":"2501.12393","last_updated":"2025-01-21T18:59:59Z","snapshot_observed_at":"2026-08-10T17:09:58.572255Z","submitted_at":"2025-01-21T18:59:59Z","title":"Towards Affordance-Aware Articulation Synthesis for Rigged Objects","version":1},"reference_index":51,"source":"pdf_text","source_observed_at":"2026-08-10T17:16:30.798785Z"},"links":{"citing_paper":"/paper/2501.12393"},"observation_digest":"sha256:134f021bc72004636068d80752666480f62c2dd5f6d95d866b90a9c77a34d856","observation_id":"35dfeef2-da49-4cf5-9841-b499edf489ba","resolution":{"observed_at":"2026-08-10T17:16:31.058701Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T17:16:31.041054Z","title":"Place: Proximity learning of articulation and con- tact in 3d environments","venue":null,"work_id":"c142bc74-e4c9-42ca-9438-0c43332aeb1d","year":2020},"citing_paper":{"arxiv_id":"2501.12393","last_updated":"2025-01-21T18:59:59Z","snapshot_observed_at":"2026-08-10T17:09:58.572255Z","submitted_at":"2025-01-21T18:59:59Z","title":"Towards Affordance-Aware Articulation Synthesis for Rigged Objects","version":1},"reference_index":52,"source":"pdf_text","source_observed_at":"2026-08-10T17:16:30.802220Z"},"links":{"citing_paper":"/paper/2501.12393"},"observation_digest":"sha256:5069a8068cfa554fe721798ae5a02f6e007e1cdf745441a950b5d9c4485450b4","observation_id":"b4bd9d19-f50b-431a-99f9-5a41a1b83d66","resolution":{"observed_at":"2026-08-10T17:16:31.045933Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T17:16:31.027405Z","title":"Generating 3d people in scenes with- out people","venue":null,"work_id":"05f14a09-3dd6-4c01-bcf1-9135526b793d","year":2020},"citing_paper":{"arxiv_id":"2501.12393","last_updated":"2025-01-21T18:59:59Z","snapshot_observed_at":"2026-08-10T17:09:58.572255Z","submitted_at":"2025-01-21T18:59:59Z","title":"Towards Affordance-Aware Articulation Synthesis for Rigged Objects","version":1},"reference_index":53,"source":"pdf_text","source_observed_at":"2026-08-10T17:16:30.806081Z"},"links":{"citing_paper":"/paper/2501.12393"},"observation_digest":"sha256:a320d07a4b7e36111205319f178bb34b830998cfe94e1733236239253e2faad3","observation_id":"df28bf6b-2f3b-4899-bd3f-be693b84b501","resolution":{"observed_at":"2026-08-10T17:16:31.031400Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T17:16:31.014723Z","title":"Compositional human-scene interaction synthe- sis with semantic control","venue":null,"work_id":"71bff5ee-66b5-4396-afcf-b9154cf6dd33","year":2022},"citing_paper":{"arxiv_id":"2501.12393","last_updated":"2025-01-21T18:59:59Z","snapshot_observed_at":"2026-08-10T17:09:58.572255Z","submitted_at":"2025-01-21T18:59:59Z","title":"Towards Affordance-Aware Articulation Synthesis for Rigged Objects","version":1},"reference_index":54,"source":"pdf_text","source_observed_at":"2026-08-10T17:16:30.809849Z"},"links":{"citing_paper":"/paper/2501.12393"},"observation_digest":"sha256:3c0ceb9592a5dc99a376ec24ac15594d455b2be89ffcceb2ed562c2e1bbf0154","observation_id":"59eea264-d9e2-4226-8598-842d37ab3d2f","resolution":{"observed_at":"2026-08-10T17:16:31.018991Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T17:16:31.001336Z","title":"HIFA: High- fidelity text-to-3d generation with advanced diffusion guid- ance","venue":null,"work_id":"95ea8f43-4faa-4a7b-9cdb-8c97119bac81","year":2024},"citing_paper":{"arxiv_id":"2501.12393","last_updated":"2025-01-21T18:59:59Z","snapshot_observed_at":"2026-08-10T17:09:58.572255Z","submitted_at":"2025-01-21T18:59:59Z","title":"Towards Affordance-Aware Articulation Synthesis for Rigged Objects","version":1},"reference_index":55,"source":"pdf_text","source_observed_at":"2026-08-10T17:16:30.813447Z"},"links":{"citing_paper":"/paper/2501.12393"},"observation_digest":"sha256:4811cb371fd4ab4ca66396480aea4f2437e63a8fb5b2ebc3c3a20b35e4b391c1","observation_id":"ee9bf80d-2a71-4c76-b675-6a5dfb5182fa","resolution":{"observed_at":"2026-08-10T17:16:31.005915Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2409.08278","last_updated":"2024-09-12T17:59:49Z","snapshot_observed_at":"2026-07-06T19:14:33.669810Z","submitted_at":"2024-09-12T17:59:49Z","title":"DreamHOI: Subject-Driven Generation of 3D Human-Object Interactions with Diffusion Priors","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2409.08278","snapshot_observed_at":"2026-08-10T17:16:30.816963Z","title":"DreamHOI: Subject-driven generation of 3d human- object interactions with diffusion priors","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2501.12393","last_updated":"2025-01-21T18:59:59Z","snapshot_observed_at":"2026-08-10T17:09:58.572255Z","submitted_at":"2025-01-21T18:59:59Z","title":"Towards Affordance-Aware Articulation Synthesis for Rigged Objects","version":1},"reference_index":56,"source":"pdf_text","source_observed_at":"2026-08-10T17:16:30.816963Z"},"links":{"cited_paper":"/paper/2409.08278","citing_paper":"/paper/2501.12393"},"observation_digest":"sha256:921fcc5750f9eb3e4bf6e77ccd38b8ed642f0314a93fd9bf6e01bfd1d2eb9a6c","observation_id":"abdc582e-8f56-4db9-a80c-fcc148c7a494","resolution":{"observed_at":"2026-08-10T17:16:30.816963Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T17:16:30.988992Z","title":"Reasoning about object affordances in a knowledge base representation","venue":null,"work_id":"b459e212-3612-4844-b1f9-30a395fb26a3","year":2014},"citing_paper":{"arxiv_id":"2501.12393","last_updated":"2025-01-21T18:59:59Z","snapshot_observed_at":"2026-08-10T17:09:58.572255Z","submitted_at":"2025-01-21T18:59:59Z","title":"Towards Affordance-Aware Articulation Synthesis for Rigged Objects","version":1},"reference_index":57,"source":"pdf_text","source_observed_at":"2026-08-10T17:16:30.820886Z"},"links":{"citing_paper":"/paper/2501.12393"},"observation_digest":"sha256:b86055166cf3e13f1ed1272d3cd1c0e63bd310ba5244c795c16db21720ebf5a0","observation_id":"2c948382-33a9-4c32-b5d9-f2c2c5ff14d7","resolution":{"observed_at":"2026-08-10T17:16:30.993072Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T17:16:30.976169Z","title":"< PROMPT>","venue":null,"work_id":"8db9ef89-dd1a-4a1a-a50c-8e9c41e422d8","year":2016},"citing_paper":{"arxiv_id":"2501.12393","last_updated":"2025-01-21T18:59:59Z","snapshot_observed_at":"2026-08-10T17:09:58.572255Z","submitted_at":"2025-01-21T18:59:59Z","title":"Towards Affordance-Aware Articulation Synthesis for Rigged Objects","version":1},"reference_index":58,"source":"pdf_text","source_observed_at":"2026-08-10T17:16:30.824612Z"},"links":{"citing_paper":"/paper/2501.12393"},"observation_digest":"sha256:194d8abc1d9297fef4b1827f3322c8b4fbf0ef5644c6ef4ff266914ed09a0a19","observation_id":"139b290d-68ce-406e-aab7-2eee1ee4f5f5","resolution":{"observed_at":"2026-08-10T17:16:30.980360Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}}],"paper":{"arxiv_id":"2501.12393","last_updated":"2025-01-21T18:59:59Z","latest_version":1,"primary_category":"cs.CV","snapshot_observed_at":"2026-08-10T17:09:58.572255Z","submitted_at":"2025-01-21T18:59:59Z","title":"Towards Affordance-Aware Articulation Synthesis for Rigged Objects"},"reference_resolution":{"displayed":58,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":9,"verified_exact":2,"verified_fuzzy":47},"total_outbound_references":58},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"thesis":"As of 11 August 2026, this Paper Citation Record lists 58 of 58 outbound references and 0 inbound Pith citation observations for arXiv:2501.12393."}