{"as_of":"2026-08-10T17:46:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:97accf53073e88c1e0066a8a891a794b2deba55dbf61ced1e6b6417e6f5716c0","coverage":[{"denominator":67,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":67,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-07T12:34:29.029262Z","state":"measured"},{"denominator":67,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":67,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-10T06:31:04.303077+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2505.24315/citation-record","integrity":"/paper/2505.24315/integrity","json":"/paper/2505.24315/citation-record.json","paper":"/paper/2505.24315"},"outbound":[{"citation":{"cited_paper":{"arxiv_id":"2303.08774","last_updated":"2024-03-04T06:01:33Z","snapshot_observed_at":"2026-08-07T07:30:12.213965Z","submitted_at":"2023-03-15T17:15:04Z","title":"GPT-4 Technical Report","version":6},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2303.08774","snapshot_observed_at":"2026-08-07T12:34:23.464217Z","title":"Gpt-4 technical report.arXiv preprint arXiv:2303.08774,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2505.24315","last_updated":"2025-05-30T07:53:55Z","snapshot_observed_at":"2026-08-09T19:35:40.557870Z","submitted_at":"2025-05-30T07:53:55Z","title":"InteractAnything: Zero-shot Human Object Interaction Synthesis via LLM Feedback and Object Affordance Parsing","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-07T12:34:23.464217Z"},"links":{"cited_paper":"/paper/2303.08774","citing_paper":"/paper/2505.24315"},"observation_digest":"sha256:943b0e2efdeb82f21a784a9dd577dad998e09760bb42eee7e285bbd44deb8fd2","observation_id":"9003a705-6a19-46a8-9b1f-a5b817d3ea81","resolution":{"observed_at":"2026-08-07T12:34:23.464217Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:34:39.238013Z","title":"Behave: Dataset and method for tracking human object in- teractions","venue":null,"work_id":"1f1c7435-2583-44cb-a134-ac38fb28619e","year":2022},"citing_paper":{"arxiv_id":"2505.24315","last_updated":"2025-05-30T07:53:55Z","snapshot_observed_at":"2026-08-09T19:35:40.557870Z","submitted_at":"2025-05-30T07:53:55Z","title":"InteractAnything: Zero-shot Human Object Interaction Synthesis via LLM Feedback and Object Affordance Parsing","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-07T12:34:23.572508Z"},"links":{"citing_paper":"/paper/2505.24315"},"observation_digest":"sha256:75e49641e9db8fc1adeda4676fa9ada6e4f6383b0763b775171284006ab1075e","observation_id":"fbeb8fbc-ec17-41fe-a29a-e6fe49c839f9","resolution":{"observed_at":"2026-08-07T12:34:39.302785Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:34:39.072235Z","title":null,"venue":null,"work_id":"9632736d-0d41-4655-9bff-205c20a732c6","year":2016},"citing_paper":{"arxiv_id":"2505.24315","last_updated":"2025-05-30T07:53:55Z","snapshot_observed_at":"2026-08-09T19:35:40.557870Z","submitted_at":"2025-05-30T07:53:55Z","title":"InteractAnything: Zero-shot Human Object Interaction Synthesis via LLM Feedback and Object Affordance Parsing","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-07T12:34:23.671727Z"},"links":{"citing_paper":"/paper/2505.24315"},"observation_digest":"sha256:a249e45f17f7279b71f23ba36356c02ef7674a577cb8d45dc4d80173c74965aa","observation_id":"ced04d31-9aab-407c-bea2-2659ecbc4f5a","resolution":{"observed_at":"2026-08-07T12:34:39.145179Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:34:23.769585Z","title":"Dreamavatar: Text-and-shape guided 3d hu- man avatar generation via diffusion models","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.24315","last_updated":"2025-05-30T07:53:55Z","snapshot_observed_at":"2026-08-09T19:35:40.557870Z","submitted_at":"2025-05-30T07:53:55Z","title":"InteractAnything: Zero-shot Human Object Interaction Synthesis via LLM Feedback and Object Affordance Parsing","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-07T12:34:23.769585Z"},"links":{"citing_paper":"/paper/2505.24315"},"observation_digest":"sha256:deb42c209b10ce45cd06e1c87721d7321de92f4b5f2ee406c669a3e9acb2c9c4","observation_id":"f6875bfe-107a-4879-bf09-fc4386193f2a","resolution":{"observed_at":"2026-08-07T12:34:23.769585Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:34:38.848204Z","title":"Realtime multi-person 2d pose estimation using part affin- ity fields","venue":null,"work_id":"c19760a8-afd3-40ee-9f19-bc419ef68b44","year":2017},"citing_paper":{"arxiv_id":"2505.24315","last_updated":"2025-05-30T07:53:55Z","snapshot_observed_at":"2026-08-09T19:35:40.557870Z","submitted_at":"2025-05-30T07:53:55Z","title":"InteractAnything: Zero-shot Human Object Interaction Synthesis via LLM Feedback and Object Affordance Parsing","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-07T12:34:23.849556Z"},"links":{"citing_paper":"/paper/2505.24315"},"observation_digest":"sha256:a6cb13415d7d9b1344f30bc8fe90d4e5fece3375ed5aff2da5f1e382b037bb02","observation_id":"b9512357-b643-40fe-b224-4ade415acbce","resolution":{"observed_at":"2026-08-07T12:34:38.940621Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:34:38.669602Z","title":"Fan- tasia3d: Disentangling geometry and appearance for high- quality text-to-3d content creation","venue":null,"work_id":"2d00fc15-826f-4e43-9170-b9eb65ea9e4d","year":2023},"citing_paper":{"arxiv_id":"2505.24315","last_updated":"2025-05-30T07:53:55Z","snapshot_observed_at":"2026-08-09T19:35:40.557870Z","submitted_at":"2025-05-30T07:53:55Z","title":"InteractAnything: Zero-shot Human Object Interaction Synthesis via LLM Feedback and Object Affordance Parsing","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-07T12:34:23.929980Z"},"links":{"citing_paper":"/paper/2505.24315"},"observation_digest":"sha256:aa4c5c76726bb9642b69509487017549dd9c81767ba4184ebd8bed7b49c119c5","observation_id":"69564551-ef48-401d-8ba5-18ac51609ef6","resolution":{"observed_at":"2026-08-07T12:34:38.744471Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:34:38.430395Z","title":"Comboverse: Compositional 3d as- sets creation using spatially-aware diffusion guidance","venue":null,"work_id":"9ff5cc61-c28c-4f7a-977b-62f9ad665b4f","year":2024},"citing_paper":{"arxiv_id":"2505.24315","last_updated":"2025-05-30T07:53:55Z","snapshot_observed_at":"2026-08-09T19:35:40.557870Z","submitted_at":"2025-05-30T07:53:55Z","title":"InteractAnything: Zero-shot Human Object Interaction Synthesis via LLM Feedback and Object Affordance Parsing","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-07T12:34:24.055940Z"},"links":{"citing_paper":"/paper/2505.24315"},"observation_digest":"sha256:dab880f87110f07cb27c334da2351a3c71bd963339b752b7697a0afbc6654ca2","observation_id":"709043dd-7846-4631-a4df-11c7d7be4d60","resolution":{"observed_at":"2026-08-07T12:34:38.532362Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:34:38.268283Z","title":"Syn- thesis and optimization of force closure grasps via sequential semidefinite programming.Robotics Research: Volume 1, pages 285–305, 2018","venue":null,"work_id":"5a3c9aa1-40d4-4968-853a-13b213f21e63","year":2018},"citing_paper":{"arxiv_id":"2505.24315","last_updated":"2025-05-30T07:53:55Z","snapshot_observed_at":"2026-08-09T19:35:40.557870Z","submitted_at":"2025-05-30T07:53:55Z","title":"InteractAnything: Zero-shot Human Object Interaction Synthesis via LLM Feedback and Object Affordance Parsing","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-07T12:34:24.155695Z"},"links":{"citing_paper":"/paper/2505.24315"},"observation_digest":"sha256:42aaaefe24fa937438f7539c6acfa161084059911eb500bde8a407c2c7e3f298","observation_id":"4a899890-d660-45b7-8f3d-9e51dbc535c0","resolution":{"observed_at":"2026-08-07T12:34:38.348377Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:34:38.083737Z","title":"In- terfusion: Text-driven generation of 3d human-object inter- action","venue":null,"work_id":"79471790-a9da-4cf7-98d0-4df2ab3f19af","year":2024},"citing_paper":{"arxiv_id":"2505.24315","last_updated":"2025-05-30T07:53:55Z","snapshot_observed_at":"2026-08-09T19:35:40.557870Z","submitted_at":"2025-05-30T07:53:55Z","title":"InteractAnything: Zero-shot Human Object Interaction Synthesis via LLM Feedback and Object Affordance Parsing","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-07T12:34:24.252941Z"},"links":{"citing_paper":"/paper/2505.24315"},"observation_digest":"sha256:c2d5c2e9160fd2caab763a0fbc5e6837d9c8ab22ebd66ca5381235cc5b2b36fd","observation_id":"6bcec3c4-2833-4ec2-adfd-af44ebfb947d","resolution":{"observed_at":"2026-08-07T12:34:38.174810Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2312.11805","last_updated":"2025-05-09T21:04:06Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2023-12-19T02:39:27Z","title":"Gemini: A Family of Highly Capable Multimodal Models","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2312.11805","snapshot_observed_at":"2026-08-07T12:34:24.318806Z","title":"Gemini: A family of highly capable mul- timodal models.arXiv preprint arXiv:2312.11805, 2023","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.24315","last_updated":"2025-05-30T07:53:55Z","snapshot_observed_at":"2026-08-09T19:35:40.557870Z","submitted_at":"2025-05-30T07:53:55Z","title":"InteractAnything: Zero-shot Human Object Interaction Synthesis via LLM Feedback and Object Affordance Parsing","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-07T12:34:24.318806Z"},"links":{"cited_paper":"/paper/2312.11805","citing_paper":"/paper/2505.24315"},"observation_digest":"sha256:075643fe42b55ccce96f4bbd44ca10c4d8c2ef8c5bc10fbfa27660c22c05a092","observation_id":"7b8f75ec-8a81-4fe8-936e-de17f144abe1","resolution":{"observed_at":"2026-08-07T12:34:24.318806Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:34:37.865476Z","title":"Kaolin: A pytorch library for accelerating 3d deep learning re- search.https://github.com/NVIDIAGameWorks/ kaolin, 2022","venue":null,"work_id":"7ce2445a-b963-4161-8ccf-c3b45b44c667","year":2022},"citing_paper":{"arxiv_id":"2505.24315","last_updated":"2025-05-30T07:53:55Z","snapshot_observed_at":"2026-08-09T19:35:40.557870Z","submitted_at":"2025-05-30T07:53:55Z","title":"InteractAnything: Zero-shot Human Object Interaction Synthesis via LLM Feedback and Object Affordance Parsing","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-07T12:34:24.395981Z"},"links":{"citing_paper":"/paper/2505.24315"},"observation_digest":"sha256:6aed6eb7ee710f5e217390e6573a7541cf93e1c9125e8397c5a3bea2ab8d4859","observation_id":"8327ebe9-5948-4b8d-b990-342f612a1ca5","resolution":{"observed_at":"2026-08-07T12:34:37.948139Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:34:37.677208Z","title":"Graphdreamer: Compositional 3d scene synthesis from scene graphs","venue":null,"work_id":"de589f38-0a8e-4865-b9d8-91f5b6cfa856","year":2024},"citing_paper":{"arxiv_id":"2505.24315","last_updated":"2025-05-30T07:53:55Z","snapshot_observed_at":"2026-08-09T19:35:40.557870Z","submitted_at":"2025-05-30T07:53:55Z","title":"InteractAnything: Zero-shot Human Object Interaction Synthesis via LLM Feedback and Object Affordance Parsing","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-07T12:34:24.491487Z"},"links":{"citing_paper":"/paper/2505.24315"},"observation_digest":"sha256:43c14745b2353cac9dbf6dd1d13d0766b8343c6192d59ebc227e8d99a2479beb","observation_id":"80058044-0048-4d5a-aa93-808fda86aa13","resolution":{"observed_at":"2026-08-07T12:34:37.763080Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:34:37.501789Z","title":"Diffpose: Toward more reliable 3d pose estimation","venue":null,"work_id":"0bf9041c-2de3-4c91-be6c-b5fb5ed263e2","year":2023},"citing_paper":{"arxiv_id":"2505.24315","last_updated":"2025-05-30T07:53:55Z","snapshot_observed_at":"2026-08-09T19:35:40.557870Z","submitted_at":"2025-05-30T07:53:55Z","title":"InteractAnything: Zero-shot Human Object Interaction Synthesis via LLM Feedback and Object Affordance Parsing","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-07T12:34:24.562050Z"},"links":{"citing_paper":"/paper/2505.24315"},"observation_digest":"sha256:c2496ecb99518df2a77d15a091aa22903ba5d619eb28edefd2244d0b4d93b10d","observation_id":"0a6f60c6-4fa9-4c8c-bb12-ac9c42d92596","resolution":{"observed_at":"2026-08-07T12:34:37.582689Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:34:37.340894Z","title":"Human poseitioning system (hps): 3d human pose estimation and self-localization in large scenes from body-mounted sensors","venue":null,"work_id":"8546a099-b6f2-473e-afe7-7550158f978f","year":2021},"citing_paper":{"arxiv_id":"2505.24315","last_updated":"2025-05-30T07:53:55Z","snapshot_observed_at":"2026-08-09T19:35:40.557870Z","submitted_at":"2025-05-30T07:53:55Z","title":"InteractAnything: Zero-shot Human Object Interaction Synthesis via LLM Feedback and Object Affordance Parsing","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-07T12:34:24.628178Z"},"links":{"citing_paper":"/paper/2505.24315"},"observation_digest":"sha256:5da58ada5258eaa0a89c6b1426aadf25149444efd8b5af7fdb8a1b365f68636b","observation_id":"4bd1311f-f907-4c79-bd1f-6ea03fc9f034","resolution":{"observed_at":"2026-08-07T12:34:37.430029Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:34:37.174730Z","title":"Chorus: Learning canon- icalized 3d human-object spatial relations from unbounded synthesized images","venue":null,"work_id":"0116d523-027f-4177-ab22-1b1372308bf2","year":2023},"citing_paper":{"arxiv_id":"2505.24315","last_updated":"2025-05-30T07:53:55Z","snapshot_observed_at":"2026-08-09T19:35:40.557870Z","submitted_at":"2025-05-30T07:53:55Z","title":"InteractAnything: Zero-shot Human Object Interaction Synthesis via LLM Feedback and Object Affordance Parsing","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-07T12:34:24.738435Z"},"links":{"citing_paper":"/paper/2505.24315"},"observation_digest":"sha256:5e395f94b780a069cad5a451f755f650f3b9e988a57fe439578c75115784cde5","observation_id":"795cf2df-cff1-4d9a-bd2b-2a87b7cac36c","resolution":{"observed_at":"2026-08-07T12:34:37.246804Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:34:37.031540Z","title":null,"venue":null,"work_id":"7fb2986c-991b-436d-aa62-ba141cb24ce0","year":2019},"citing_paper":{"arxiv_id":"2505.24315","last_updated":"2025-05-30T07:53:55Z","snapshot_observed_at":"2026-08-09T19:35:40.557870Z","submitted_at":"2025-05-30T07:53:55Z","title":"InteractAnything: Zero-shot Human Object Interaction Synthesis via LLM Feedback and Object Affordance Parsing","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-07T12:34:24.807060Z"},"links":{"citing_paper":"/paper/2505.24315"},"observation_digest":"sha256:81c987be55f70c1985d3a48cd50735500804136146a092ee1f370b6291a4b3e5","observation_id":"49c3a889-1553-4787-8c4b-d654268adaf9","resolution":{"observed_at":"2026-08-07T12:34:37.102801Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2205.08535","last_updated":"2022-05-17T17:59:19Z","snapshot_observed_at":"2026-08-09T03:41:49.677248Z","submitted_at":"2022-05-17T17:59:19Z","title":"AvatarCLIP: Zero-Shot Text-Driven Generation and Animation of 3D Avatars","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2205.08535","snapshot_observed_at":"2026-08-07T12:34:24.914022Z","title":"Avatarclip: Zero-shot text- driven generation and animation of 3d avatars.arXiv preprint arXiv:2205.08535, 2022","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2505.24315","last_updated":"2025-05-30T07:53:55Z","snapshot_observed_at":"2026-08-09T19:35:40.557870Z","submitted_at":"2025-05-30T07:53:55Z","title":"InteractAnything: Zero-shot Human Object Interaction Synthesis via LLM Feedback and Object Affordance Parsing","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-07T12:34:24.914022Z"},"links":{"cited_paper":"/paper/2205.08535","citing_paper":"/paper/2505.24315"},"observation_digest":"sha256:58ee58663f65cad48767cf6a20482f854890fe35f939f6fcd28f2946146ed726","observation_id":"bce008d3-0ac8-4c9b-b660-b93137f4811a","resolution":{"observed_at":"2026-08-07T12:34:24.914022Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:34:25.001524Z","title":"Gauhuman: Articu- lated gaussian splatting from monocular human videos","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.24315","last_updated":"2025-05-30T07:53:55Z","snapshot_observed_at":"2026-08-09T19:35:40.557870Z","submitted_at":"2025-05-30T07:53:55Z","title":"InteractAnything: Zero-shot Human Object Interaction Synthesis via LLM Feedback and Object Affordance Parsing","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-07T12:34:25.001524Z"},"links":{"citing_paper":"/paper/2505.24315"},"observation_digest":"sha256:dae07e48f60ea1533e3b29d740dd7c6b4302fa305cbcacbe5090572bd2da1162","observation_id":"8e55421b-92d4-49d7-88ae-62b6d3b77c7f","resolution":{"observed_at":"2026-08-07T12:34:25.001524Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1802.01698","last_updated":"2018-02-05T21:31:21Z","snapshot_observed_at":"2026-07-06T06:21:53.919801Z","submitted_at":"2018-02-05T21:31:21Z","title":"Robust Watertight Manifold Surface Generation Method for ShapeNet Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1802.01698","snapshot_observed_at":"2026-08-07T12:34:25.044332Z","title":"Robust water- tight manifold surface generation method for shapenet mod- els.arXiv preprint arXiv:1802.01698, 2018","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2505.24315","last_updated":"2025-05-30T07:53:55Z","snapshot_observed_at":"2026-08-09T19:35:40.557870Z","submitted_at":"2025-05-30T07:53:55Z","title":"InteractAnything: Zero-shot Human Object Interaction Synthesis via LLM Feedback and Object Affordance Parsing","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-07T12:34:25.044332Z"},"links":{"cited_paper":"/paper/1802.01698","citing_paper":"/paper/2505.24315"},"observation_digest":"sha256:f6598eed6f87f0bce3d5a8fbfd27e4329e5daf8406f1dd5d5f922c12c27b280b","observation_id":"f5cc5e40-5613-4d27-a2da-4331c5a8346a","resolution":{"observed_at":"2026-08-07T12:34:25.044332Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:34:36.878010Z","title":"Full-body articulated human-object interaction","venue":null,"work_id":"7f0df744-d503-4714-85c5-78c5f813a8c7","year":2023},"citing_paper":{"arxiv_id":"2505.24315","last_updated":"2025-05-30T07:53:55Z","snapshot_observed_at":"2026-08-09T19:35:40.557870Z","submitted_at":"2025-05-30T07:53:55Z","title":"InteractAnything: Zero-shot Human Object Interaction Synthesis via LLM Feedback and Object Affordance Parsing","version":1},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-07T12:34:25.162521Z"},"links":{"citing_paper":"/paper/2505.24315"},"observation_digest":"sha256:f398a13b7335722b39a207c5739c0190c26be14b462cb8d804ccd33218bda32b","observation_id":"7db2b8cb-79d3-4345-80df-4f8ea8da47f1","resolution":{"observed_at":"2026-08-07T12:34:36.949422Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:34:36.686453Z","title":"Scaling up dynamic human-scene interaction model- ing","venue":null,"work_id":"edc5ad41-b71d-4506-8c20-dac6accc85bf","year":2024},"citing_paper":{"arxiv_id":"2505.24315","last_updated":"2025-05-30T07:53:55Z","snapshot_observed_at":"2026-08-09T19:35:40.557870Z","submitted_at":"2025-05-30T07:53:55Z","title":"InteractAnything: Zero-shot Human Object Interaction Synthesis via LLM Feedback and Object Affordance Parsing","version":1},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-07T12:34:25.243063Z"},"links":{"citing_paper":"/paper/2505.24315"},"observation_digest":"sha256:4707b02f19e92676c4cf8b9d1214665fb974f1fb047c79daf9c138a27f5292de","observation_id":"f8ab66c7-1cb6-412b-9677-43881da28576","resolution":{"observed_at":"2026-08-07T12:34:36.772744Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:34:36.503851Z","title":"End-to-end recovery of human shape and pose","venue":null,"work_id":"bcc8c6ea-32e6-4b9e-8f27-c18961ae9a89","year":2018},"citing_paper":{"arxiv_id":"2505.24315","last_updated":"2025-05-30T07:53:55Z","snapshot_observed_at":"2026-08-09T19:35:40.557870Z","submitted_at":"2025-05-30T07:53:55Z","title":"InteractAnything: Zero-shot Human Object Interaction Synthesis via LLM Feedback and Object Affordance Parsing","version":1},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-07T12:34:25.342077Z"},"links":{"citing_paper":"/paper/2505.24315"},"observation_digest":"sha256:22b9f7729e4049a3781006724057890b2d0a529397c378d3670a3df01aeb01ec","observation_id":"2a7f2f63-f289-4164-868d-90b18848d457","resolution":{"observed_at":"2026-08-07T12:34:36.609109Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:34:36.297788Z","title":"Maximizing parallelism in the construc- tion of bvhs, octrees, and k-d trees","venue":null,"work_id":"97e40ca9-3271-463a-bc3e-1bf7d8c515c1","year":2012},"citing_paper":{"arxiv_id":"2505.24315","last_updated":"2025-05-30T07:53:55Z","snapshot_observed_at":"2026-08-09T19:35:40.557870Z","submitted_at":"2025-05-30T07:53:55Z","title":"InteractAnything: Zero-shot Human Object Interaction Synthesis via LLM Feedback and Object Affordance Parsing","version":1},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-07T12:34:25.439992Z"},"links":{"citing_paper":"/paper/2505.24315"},"observation_digest":"sha256:0089881b6b06bf5df281b47ea5e44d7c08e907662a247d6d7058c9803324ae55","observation_id":"6b977b02-fde5-4999-b7f2-800fd98f0fa0","resolution":{"observed_at":"2026-08-07T12:34:36.390008Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:34:25.524391Z","title":"3d gaussian splatting for real-time radiance field rendering.ACM Transactions on Graphics (TOG), 42(4):139–1, 2023","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.24315","last_updated":"2025-05-30T07:53:55Z","snapshot_observed_at":"2026-08-09T19:35:40.557870Z","submitted_at":"2025-05-30T07:53:55Z","title":"InteractAnything: Zero-shot Human Object Interaction Synthesis via LLM Feedback and Object Affordance Parsing","version":1},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-07T12:34:25.524391Z"},"links":{"citing_paper":"/paper/2505.24315"},"observation_digest":"sha256:0044a83bac87ab19741513b6ca54f902381e91cd6ec2455a62c1dd6aa18c3ffc","observation_id":"9dc19d9f-244f-4e94-b7c3-0320013d5a1c","resolution":{"observed_at":"2026-08-07T12:34:25.524391Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:34:36.084065Z","title":"Beyond the contact: Discovering comprehensive affordance for 3d objects from pre-trained 2d diffusion models","venue":null,"work_id":"15e18305-9a4a-4c57-9bad-be000592e0b6","year":2024},"citing_paper":{"arxiv_id":"2505.24315","last_updated":"2025-05-30T07:53:55Z","snapshot_observed_at":"2026-08-09T19:35:40.557870Z","submitted_at":"2025-05-30T07:53:55Z","title":"InteractAnything: Zero-shot Human Object Interaction Synthesis via LLM Feedback and Object Affordance Parsing","version":1},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-08-07T12:34:25.593645Z"},"links":{"citing_paper":"/paper/2505.24315"},"observation_digest":"sha256:9925ef0d6911790fe39047b61353e200bcd34a2ef31a47501b13be618db69222","observation_id":"4ac260d9-3129-4a07-a85f-b543244d7faa","resolution":{"observed_at":"2026-08-07T12:34:36.185041Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:34:35.913741Z","title":"Object motion guided human motion synthesis.ACM Transactions on Graphics (TOG), 42(6):1–11, 2023","venue":null,"work_id":"99a8a4c0-48e8-4169-8063-5a7bf8faf582","year":2023},"citing_paper":{"arxiv_id":"2505.24315","last_updated":"2025-05-30T07:53:55Z","snapshot_observed_at":"2026-08-09T19:35:40.557870Z","submitted_at":"2025-05-30T07:53:55Z","title":"InteractAnything: Zero-shot Human Object Interaction Synthesis via LLM Feedback and Object Affordance Parsing","version":1},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-08-07T12:34:25.692574Z"},"links":{"citing_paper":"/paper/2505.24315"},"observation_digest":"sha256:ac74e3abd8fbc9d18acbc2a8accd77426a544a07d9329c0eb0c7b09807e18fcc","observation_id":"72a64cf1-17be-446c-8bdb-3c61a24c35cb","resolution":{"observed_at":"2026-08-07T12:34:35.998263Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:34:35.735356Z","title":"Controllable human-object interaction synthesis","venue":null,"work_id":"16b26fbf-a137-4cbd-a02a-2e7755ce7f1a","year":2024},"citing_paper":{"arxiv_id":"2505.24315","last_updated":"2025-05-30T07:53:55Z","snapshot_observed_at":"2026-08-09T19:35:40.557870Z","submitted_at":"2025-05-30T07:53:55Z","title":"InteractAnything: Zero-shot Human Object Interaction Synthesis via LLM Feedback and Object Affordance Parsing","version":1},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-08-07T12:34:25.776254Z"},"links":{"citing_paper":"/paper/2505.24315"},"observation_digest":"sha256:452f5c98ba830c539200f13943b7f9337cd625d829ee149ac178afededb04f37","observation_id":"927a4366-3134-4a39-ac87-bb3852214678","resolution":{"observed_at":"2026-08-07T12:34:35.811126Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:34:35.519265Z","title":"Genzi: Zero-shot 3d human-scene in- teraction generation","venue":null,"work_id":"59908e55-4a7c-4bfe-a642-98b015db9a3e","year":2024},"citing_paper":{"arxiv_id":"2505.24315","last_updated":"2025-05-30T07:53:55Z","snapshot_observed_at":"2026-08-09T19:35:40.557870Z","submitted_at":"2025-05-30T07:53:55Z","title":"InteractAnything: Zero-shot Human Object Interaction Synthesis via LLM Feedback and Object Affordance Parsing","version":1},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-08-07T12:34:25.843394Z"},"links":{"citing_paper":"/paper/2505.24315"},"observation_digest":"sha256:9a18d9b78e37699f1428f4c3e2b65df5fb5de94d4dadddd230cb1fe6bb601a78","observation_id":"f6dd91af-1d4c-454e-965c-27dc24bf7325","resolution":{"observed_at":"2026-08-07T12:34:35.622672Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:34:35.273278Z","title":"Magic3d: High-resolution text-to-3d content creation","venue":null,"work_id":"1b75553c-5f56-42e2-a587-9466b3364278","year":2023},"citing_paper":{"arxiv_id":"2505.24315","last_updated":"2025-05-30T07:53:55Z","snapshot_observed_at":"2026-08-09T19:35:40.557870Z","submitted_at":"2025-05-30T07:53:55Z","title":"InteractAnything: Zero-shot Human Object Interaction Synthesis via LLM Feedback and Object Affordance Parsing","version":1},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-08-07T12:34:25.896346Z"},"links":{"citing_paper":"/paper/2505.24315"},"observation_digest":"sha256:031c6ab541af4ad7fa0645c77e202effb2cc47529241f176f9d907df8ae8733f","observation_id":"b08ee8ad-6afd-4393-84a9-5182abf2839d","resolution":{"observed_at":"2026-08-07T12:34:35.415527Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:34:35.029265Z","title":"One-stage 3d whole-body mesh recovery with component aware transformer","venue":null,"work_id":"b8ced601-1970-4101-9434-926b2dbb401b","year":2023},"citing_paper":{"arxiv_id":"2505.24315","last_updated":"2025-05-30T07:53:55Z","snapshot_observed_at":"2026-08-09T19:35:40.557870Z","submitted_at":"2025-05-30T07:53:55Z","title":"InteractAnything: Zero-shot Human Object Interaction Synthesis via LLM Feedback and Object Affordance Parsing","version":1},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-08-07T12:34:25.957223Z"},"links":{"citing_paper":"/paper/2505.24315"},"observation_digest":"sha256:9aee1c9f3098efc913f224d4bba0db97b3df36896512bd5572447aedbc458839","observation_id":"5bfd788e-ca8e-4cf0-94a9-a9f45a1d09d7","resolution":{"observed_at":"2026-08-07T12:34:35.156869Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:34:34.814052Z","title":"Zero-1-to-3: Zero-shot one image to 3d object","venue":null,"work_id":"7158e491-885f-4cdf-bfc1-a6a60993e573","year":2023},"citing_paper":{"arxiv_id":"2505.24315","last_updated":"2025-05-30T07:53:55Z","snapshot_observed_at":"2026-08-09T19:35:40.557870Z","submitted_at":"2025-05-30T07:53:55Z","title":"InteractAnything: Zero-shot Human Object Interaction Synthesis via LLM Feedback and Object Affordance Parsing","version":1},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-08-07T12:34:26.072859Z"},"links":{"citing_paper":"/paper/2505.24315"},"observation_digest":"sha256:fbb866609183534efa268395f56beec139948752d8ebba371826a1bbcfb65606","observation_id":"9f0e10d9-2069-4ef3-967f-b39b0b46b0e8","resolution":{"observed_at":"2026-08-07T12:34:34.930045Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:34:34.627001Z","title":null,"venue":null,"work_id":"c0802c20-9ca6-40b5-8215-8f84a2af8880","year":2021},"citing_paper":{"arxiv_id":"2505.24315","last_updated":"2025-05-30T07:53:55Z","snapshot_observed_at":"2026-08-09T19:35:40.557870Z","submitted_at":"2025-05-30T07:53:55Z","title":"InteractAnything: Zero-shot Human Object Interaction Synthesis via LLM Feedback and Object Affordance Parsing","version":1},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-08-07T12:34:26.142139Z"},"links":{"citing_paper":"/paper/2505.24315"},"observation_digest":"sha256:f7b355cc17be3f5736e5df13af4097ae24cf8de2180debab46bc7606a5d959d4","observation_id":"467361ea-d0b6-48c4-906a-842e0094b158","resolution":{"observed_at":"2026-08-07T12:34:34.708594Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:34:34.439770Z","title":"Humangaus- sian: Text-driven 3d human generation with gaussian splat- ting","venue":null,"work_id":"412bfa26-89f9-42bd-8bbe-f4c60d6c7310","year":2024},"citing_paper":{"arxiv_id":"2505.24315","last_updated":"2025-05-30T07:53:55Z","snapshot_observed_at":"2026-08-09T19:35:40.557870Z","submitted_at":"2025-05-30T07:53:55Z","title":"InteractAnything: Zero-shot Human Object Interaction Synthesis via LLM Feedback and Object Affordance Parsing","version":1},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-08-07T12:34:26.217644Z"},"links":{"citing_paper":"/paper/2505.24315"},"observation_digest":"sha256:5d698b1a65427cea3dfbdff52a4b1b8ceefa5ac8cc29d42fc8b70ebd78bc6c58","observation_id":"173a8ea6-4fa7-4a1c-adf5-6b0c3e2d8969","resolution":{"observed_at":"2026-08-07T12:34:34.521110Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:34:34.246611Z","title":"Syncdreamer: Gen- erating multiview-consistent images from a single-view im- age","venue":null,"work_id":"20a2d424-7d0f-4244-adc0-3c9d875c126f","year":2023},"citing_paper":{"arxiv_id":"2505.24315","last_updated":"2025-05-30T07:53:55Z","snapshot_observed_at":"2026-08-09T19:35:40.557870Z","submitted_at":"2025-05-30T07:53:55Z","title":"InteractAnything: Zero-shot Human Object Interaction Synthesis via LLM Feedback and Object Affordance Parsing","version":1},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-08-07T12:34:26.277707Z"},"links":{"citing_paper":"/paper/2505.24315"},"observation_digest":"sha256:6c6ad947e90aba3624195c22debe8903b23c2cbddbb8137566cbded94e571905","observation_id":"35ee2432-4d80-4690-90b7-76984fdce682","resolution":{"observed_at":"2026-08-07T12:34:34.346097Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:34:34.006950Z","title":"Wonder3d: Sin- gle image to 3d using cross-domain diffusion","venue":null,"work_id":"6fba1bdc-6d61-47e5-802e-b93e85ba0888","year":2024},"citing_paper":{"arxiv_id":"2505.24315","last_updated":"2025-05-30T07:53:55Z","snapshot_observed_at":"2026-08-09T19:35:40.557870Z","submitted_at":"2025-05-30T07:53:55Z","title":"InteractAnything: Zero-shot Human Object Interaction Synthesis via LLM Feedback and Object Affordance Parsing","version":1},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-08-07T12:34:26.348702Z"},"links":{"citing_paper":"/paper/2505.24315"},"observation_digest":"sha256:f495777d4deec9c6679e1aa10f161bb80ce1487b5c2f1196f289e4b90dca8e20","observation_id":"b648f298-68cc-414d-9d0c-c5218115331c","resolution":{"observed_at":"2026-08-07T12:34:34.167011Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:34:33.690919Z","title":null,"venue":null,"work_id":"4dbfc300-7e94-41fb-9041-23b84f6df6f8","year":2015},"citing_paper":{"arxiv_id":"2505.24315","last_updated":"2025-05-30T07:53:55Z","snapshot_observed_at":"2026-08-09T19:35:40.557870Z","submitted_at":"2025-05-30T07:53:55Z","title":"InteractAnything: Zero-shot Human Object Interaction Synthesis via LLM Feedback and Object Affordance Parsing","version":1},"reference_index":36,"source":"pdf_text","source_observed_at":"2026-08-07T12:34:26.427830Z"},"links":{"citing_paper":"/paper/2505.24315"},"observation_digest":"sha256:46deb2f9d1b7adfc0390f6449e7d5152bb6e3d88dc780800d59527f157d51c24","observation_id":"5ce9d57b-9af1-41ec-b181-585319ec9bf7","resolution":{"observed_at":"2026-08-07T12:34:33.843072Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:34:33.473260Z","title":"Srinivasan, Matthew Tancik, Jonathan T","venue":null,"work_id":"907a293d-547c-4519-870c-7aa31f3aa450","year":2020},"citing_paper":{"arxiv_id":"2505.24315","last_updated":"2025-05-30T07:53:55Z","snapshot_observed_at":"2026-08-09T19:35:40.557870Z","submitted_at":"2025-05-30T07:53:55Z","title":"InteractAnything: Zero-shot Human Object Interaction Synthesis via LLM Feedback and Object Affordance Parsing","version":1},"reference_index":37,"source":"pdf_text","source_observed_at":"2026-08-07T12:34:26.486985Z"},"links":{"citing_paper":"/paper/2505.24315"},"observation_digest":"sha256:ed55d2d16c0ec3bec46300de6ebb2a1ef20bca1c4315ed1078284e7153dd1a38","observation_id":"fb42e9ff-81b4-4ecc-95e7-43a5434e066e","resolution":{"observed_at":"2026-08-07T12:34:33.585278Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:34:33.189993Z","title":"Partnet: A large- scale benchmark for fine-grained and hierarchical part-level 3d object understanding","venue":null,"work_id":"b37f5d0e-2060-4694-a983-85be3e647ddb","year":2019},"citing_paper":{"arxiv_id":"2505.24315","last_updated":"2025-05-30T07:53:55Z","snapshot_observed_at":"2026-08-09T19:35:40.557870Z","submitted_at":"2025-05-30T07:53:55Z","title":"InteractAnything: Zero-shot Human Object Interaction Synthesis via LLM Feedback and Object Affordance Parsing","version":1},"reference_index":38,"source":"pdf_text","source_observed_at":"2026-08-07T12:34:26.540017Z"},"links":{"citing_paper":"/paper/2505.24315"},"observation_digest":"sha256:7ca3040fb837ce60d498f1705696fd7fbd88e821c7f6a75ff6ec9fec9b612c9a","observation_id":"bd7231b9-363b-45c6-83f8-a85d591a9df7","resolution":{"observed_at":"2026-08-07T12:34:33.321464Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:34:32.883918Z","title":"Gpt-3.5.https://platform.openai.com/ docs/models/gpt-3-5, 2023","venue":null,"work_id":"0cb03949-c7b3-483f-851b-8ad4b8111e26","year":2023},"citing_paper":{"arxiv_id":"2505.24315","last_updated":"2025-05-30T07:53:55Z","snapshot_observed_at":"2026-08-09T19:35:40.557870Z","submitted_at":"2025-05-30T07:53:55Z","title":"InteractAnything: Zero-shot Human Object Interaction Synthesis via LLM Feedback and Object Affordance Parsing","version":1},"reference_index":39,"source":"pdf_text","source_observed_at":"2026-08-07T12:34:26.597222Z"},"links":{"citing_paper":"/paper/2505.24315"},"observation_digest":"sha256:083c99b4a7d95dfbb0a7b292416b1bd2b17bdc1b49ade1dfcc93e55db5a4da92","observation_id":"6599f09f-20bc-4d42-9613-8f9be9e1fa32","resolution":{"observed_at":"2026-08-07T12:34:33.054336Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:34:32.568183Z","title":null,"venue":null,"work_id":"5f165e60-44b6-4fe2-a038-5e555b188707","year":2019},"citing_paper":{"arxiv_id":"2505.24315","last_updated":"2025-05-30T07:53:55Z","snapshot_observed_at":"2026-08-09T19:35:40.557870Z","submitted_at":"2025-05-30T07:53:55Z","title":"InteractAnything: Zero-shot Human Object Interaction Synthesis via LLM Feedback and Object Affordance Parsing","version":1},"reference_index":40,"source":"pdf_text","source_observed_at":"2026-08-07T12:34:26.652209Z"},"links":{"citing_paper":"/paper/2505.24315"},"observation_digest":"sha256:b6636e3802c54fc667e6750fba2f3244ed4eecb2f3641326228bc6cd3be3d51f","observation_id":"f9ba76f1-5aa6-4722-9beb-8835a61a42f1","resolution":{"observed_at":"2026-08-07T12:34:32.728798Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2312.06553","last_updated":"2025-07-07T05:09:32Z","snapshot_observed_at":"2026-08-06T14:47:15.286683Z","submitted_at":"2023-12-11T17:41:17Z","title":"HOI-Diff: Text-Driven Synthesis of 3D Human-Object Interactions using Diffusion Models","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2312.06553","snapshot_observed_at":"2026-08-07T12:34:26.726400Z","title":"Hoi-diff: Text-driven synthe- sis of 3d human-object interactions using diffusion models","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.24315","last_updated":"2025-05-30T07:53:55Z","snapshot_observed_at":"2026-08-09T19:35:40.557870Z","submitted_at":"2025-05-30T07:53:55Z","title":"InteractAnything: Zero-shot Human Object Interaction Synthesis via LLM Feedback and Object Affordance Parsing","version":1},"reference_index":41,"source":"pdf_text","source_observed_at":"2026-08-07T12:34:26.726400Z"},"links":{"cited_paper":"/paper/2312.06553","citing_paper":"/paper/2505.24315"},"observation_digest":"sha256:9afadc0a6747bc71d0df32253e4a603aef1a026a457c1674ea49d4806a498eb3","observation_id":"0046c9ea-27db-42b8-b70d-bddd04d9cdc0","resolution":{"observed_at":"2026-08-07T12:34:26.726400Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2307.01952","last_updated":"2023-07-04T23:04:57Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2023-07-04T23:04:57Z","title":"SDXL: Improving Latent Diffusion Models for High-Resolution Image Synthesis","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2307.01952","snapshot_observed_at":"2026-08-07T12:34:26.782337Z","title":"Sdxl: Improving latent diffusion mod- els for high-resolution image synthesis.arXiv preprint arXiv:2307.01952, 2023","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.24315","last_updated":"2025-05-30T07:53:55Z","snapshot_observed_at":"2026-08-09T19:35:40.557870Z","submitted_at":"2025-05-30T07:53:55Z","title":"InteractAnything: Zero-shot Human Object Interaction Synthesis via LLM Feedback and Object Affordance Parsing","version":1},"reference_index":42,"source":"pdf_text","source_observed_at":"2026-08-07T12:34:26.782337Z"},"links":{"cited_paper":"/paper/2307.01952","citing_paper":"/paper/2505.24315"},"observation_digest":"sha256:746a1881266187a0c47e449c0d2787d29d9df9c328e5f29bb87861045858401c","observation_id":"b7f677aa-bec7-4101-93a0-1ce9326cef0c","resolution":{"observed_at":"2026-08-07T12:34:26.782337Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:34:32.450542Z","title":"Dreamfusion: Text-to-3d using 2d diffusion","venue":null,"work_id":"877258cd-9248-4408-9a7b-77c87aec7ee1","year":null},"citing_paper":{"arxiv_id":"2505.24315","last_updated":"2025-05-30T07:53:55Z","snapshot_observed_at":"2026-08-09T19:35:40.557870Z","submitted_at":"2025-05-30T07:53:55Z","title":"InteractAnything: Zero-shot Human Object Interaction Synthesis via LLM Feedback and Object Affordance Parsing","version":1},"reference_index":43,"source":"pdf_text","source_observed_at":"2026-08-07T12:34:26.834879Z"},"links":{"citing_paper":"/paper/2505.24315"},"observation_digest":"sha256:aa91e2a7b6a3ad7471a606b7f0f7f33c642ff99c831b4d9389363fa20f83ef97","observation_id":"2eb95b75-d44d-4702-8a8c-1049e1538ac9","resolution":{"observed_at":"2026-08-07T12:34:32.512312Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:34:32.290061Z","title":"Ramesh, Gabriel Goh, Sandhini Agarwal, Girish Sastry, Askell Amanda, Pamela Mishkin, Jack Clark, Gretchen Krueger, and Ilya Sutskever","venue":null,"work_id":"d52fb900-3bf7-465c-a21e-a2f03d5c9268","year":2021},"citing_paper":{"arxiv_id":"2505.24315","last_updated":"2025-05-30T07:53:55Z","snapshot_observed_at":"2026-08-09T19:35:40.557870Z","submitted_at":"2025-05-30T07:53:55Z","title":"InteractAnything: Zero-shot Human Object Interaction Synthesis via LLM Feedback and Object Affordance Parsing","version":1},"reference_index":44,"source":"pdf_text","source_observed_at":"2026-08-07T12:34:26.907187Z"},"links":{"citing_paper":"/paper/2505.24315"},"observation_digest":"sha256:bcf65083ba9a7a51b93ac7a3dd3f6b0cd658567e8cdc4947895ab07c13019dd3","observation_id":"97f3db08-eb09-4785-8fe3-50733e01d324","resolution":{"observed_at":"2026-08-07T12:34:32.367270Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2204.06125","last_updated":"2022-04-13T01:10:33Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2022-04-13T01:10:33Z","title":"Hierarchical Text-Conditional Image Generation with CLIP Latents","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2204.06125","snapshot_observed_at":"2026-08-07T12:34:26.977185Z","title":"Hierarchical text-conditional image gen- eration with clip latents.arXiv preprint arXiv:2204.06125,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2505.24315","last_updated":"2025-05-30T07:53:55Z","snapshot_observed_at":"2026-08-09T19:35:40.557870Z","submitted_at":"2025-05-30T07:53:55Z","title":"InteractAnything: Zero-shot Human Object Interaction Synthesis via LLM Feedback and Object Affordance Parsing","version":1},"reference_index":45,"source":"pdf_text","source_observed_at":"2026-08-07T12:34:26.977185Z"},"links":{"cited_paper":"/paper/2204.06125","citing_paper":"/paper/2505.24315"},"observation_digest":"sha256:73a827d7d9f43d7bee8f647c3711c748314ca85b3224b8dd6593d1745f670a48","observation_id":"57ae142d-85f4-4d6b-b2cf-6cf438683c7e","resolution":{"observed_at":"2026-08-07T12:34:26.977185Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:34:32.117964Z","title":"High-resolution image syn- thesis with latent diffusion models","venue":null,"work_id":"22ae3356-a828-4c7c-8b61-7a7eff45ba4e","year":2022},"citing_paper":{"arxiv_id":"2505.24315","last_updated":"2025-05-30T07:53:55Z","snapshot_observed_at":"2026-08-09T19:35:40.557870Z","submitted_at":"2025-05-30T07:53:55Z","title":"InteractAnything: Zero-shot Human Object Interaction Synthesis via LLM Feedback and Object Affordance Parsing","version":1},"reference_index":46,"source":"pdf_text","source_observed_at":"2026-08-07T12:34:27.049387Z"},"links":{"citing_paper":"/paper/2505.24315"},"observation_digest":"sha256:84f0b12c211a03ee8aa3399a7ddd2aaa5e2954870408236d82a9775c171722da","observation_id":"5e1f11c6-49ce-4666-906e-0a370e7b2638","resolution":{"observed_at":"2026-08-07T12:34:32.209624Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:34:27.119841Z","title":"High-resolution image synthesis with latent diffusion models","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2505.24315","last_updated":"2025-05-30T07:53:55Z","snapshot_observed_at":"2026-08-09T19:35:40.557870Z","submitted_at":"2025-05-30T07:53:55Z","title":"InteractAnything: Zero-shot Human Object Interaction Synthesis via LLM Feedback and Object Affordance Parsing","version":1},"reference_index":47,"source":"pdf_text","source_observed_at":"2026-08-07T12:34:27.119841Z"},"links":{"citing_paper":"/paper/2505.24315"},"observation_digest":"sha256:731e298bb40ad375282a8e0004c838acff75114816ef33ecc7814facd8eeb7be","observation_id":"b2e38205-b5c1-4d76-b95b-613b2dfdbb7b","resolution":{"observed_at":"2026-08-07T12:34:27.119841Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:34:31.886777Z","title":"Em- bodied hands: modeling and capturing hands and bodies to- gether.ACM Transactions on Graphics (TOG), 36(6):1–17,","venue":null,"work_id":"d1df4aec-e02a-406b-b960-eef43413c147","year":null},"citing_paper":{"arxiv_id":"2505.24315","last_updated":"2025-05-30T07:53:55Z","snapshot_observed_at":"2026-08-09T19:35:40.557870Z","submitted_at":"2025-05-30T07:53:55Z","title":"InteractAnything: Zero-shot Human Object Interaction Synthesis via LLM Feedback and Object Affordance Parsing","version":1},"reference_index":48,"source":"pdf_text","source_observed_at":"2026-08-07T12:34:27.163777Z"},"links":{"citing_paper":"/paper/2505.24315"},"observation_digest":"sha256:00801a82b744bf50290972e6cf4a5a7f8c436b10f3e348241775ab728a1ea5c9","observation_id":"269fa7aa-d000-4dbe-9b5e-d375de924f65","resolution":{"observed_at":"2026-08-07T12:34:32.024914Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:34:31.712344Z","title":"Dreambooth: Fine tuning text-to-image diffusion models for subject-driven generation","venue":null,"work_id":"dffad0f0-2694-4b25-bbfe-532515705c7b","year":2023},"citing_paper":{"arxiv_id":"2505.24315","last_updated":"2025-05-30T07:53:55Z","snapshot_observed_at":"2026-08-09T19:35:40.557870Z","submitted_at":"2025-05-30T07:53:55Z","title":"InteractAnything: Zero-shot Human Object Interaction Synthesis via LLM Feedback and Object Affordance Parsing","version":1},"reference_index":49,"source":"pdf_text","source_observed_at":"2026-08-07T12:34:27.195627Z"},"links":{"citing_paper":"/paper/2505.24315"},"observation_digest":"sha256:357d80d2dd89009358c7d6297760e25d01b46ea46715426e107a887d61bcfce2","observation_id":"b28c8125-fcc9-4bb9-837e-9387b3c44f3f","resolution":{"observed_at":"2026-08-07T12:34:31.805285Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:34:27.341450Z","title":"Photorealistic text-to-image diffusion models with deep language understanding","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2505.24315","last_updated":"2025-05-30T07:53:55Z","snapshot_observed_at":"2026-08-09T19:35:40.557870Z","submitted_at":"2025-05-30T07:53:55Z","title":"InteractAnything: Zero-shot Human Object Interaction Synthesis via LLM Feedback and Object Affordance Parsing","version":1},"reference_index":50,"source":"pdf_text","source_observed_at":"2026-08-07T12:34:27.341450Z"},"links":{"citing_paper":"/paper/2505.24315"},"observation_digest":"sha256:d881ba83ddf43ceee0218863d9288e242ab4a265945192be8a9471d6072dd5d0","observation_id":"9fbd90b6-7a4b-421f-94f6-4e987de201c3","resolution":{"observed_at":"2026-08-07T12:34:27.341450Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2310.15110","last_updated":"2023-10-23T17:18:59Z","snapshot_observed_at":"2026-07-06T16:37:19.963994Z","submitted_at":"2023-10-23T17:18:59Z","title":"Zero123++: a Single Image to Consistent Multi-view Diffusion Base Model","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2310.15110","snapshot_observed_at":"2026-08-07T12:34:27.452697Z","title":"Zero123++: a single image to consistent multi-view dif- fusion base model.arXiv preprint arXiv:2310.15110, 2023","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2505.24315","last_updated":"2025-05-30T07:53:55Z","snapshot_observed_at":"2026-08-09T19:35:40.557870Z","submitted_at":"2025-05-30T07:53:55Z","title":"InteractAnything: Zero-shot Human Object Interaction Synthesis via LLM Feedback and Object Affordance Parsing","version":1},"reference_index":51,"source":"pdf_text","source_observed_at":"2026-08-07T12:34:27.452697Z"},"links":{"cited_paper":"/paper/2310.15110","citing_paper":"/paper/2505.24315"},"observation_digest":"sha256:863665f9bb52c03626a78b2a46208251a61c64ebe7566f24212ed6104180bb69","observation_id":"8486b070-3a80-4faf-9deb-c566fb2e561e","resolution":{"observed_at":"2026-08-07T12:34:27.452697Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2308.16512","last_updated":"2024-04-18T04:12:32Z","snapshot_observed_at":"2026-07-06T16:12:38.269310Z","submitted_at":"2023-08-31T07:49:06Z","title":"MVDream: Multi-view Diffusion for 3D Generation","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2308.16512","snapshot_observed_at":"2026-08-07T12:34:27.602865Z","title":"Mvdream: Multi-view diffusion for 3d gen- eration.arXiv preprint arXiv:2308.16512, 2023","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.24315","last_updated":"2025-05-30T07:53:55Z","snapshot_observed_at":"2026-08-09T19:35:40.557870Z","submitted_at":"2025-05-30T07:53:55Z","title":"InteractAnything: Zero-shot Human Object Interaction Synthesis via LLM Feedback and Object Affordance Parsing","version":1},"reference_index":52,"source":"pdf_text","source_observed_at":"2026-08-07T12:34:27.602865Z"},"links":{"cited_paper":"/paper/2308.16512","citing_paper":"/paper/2505.24315"},"observation_digest":"sha256:ed651d0b2eec9144d30a535374f2b63032ff5c5f03f6e2c95bac7c08dfe17041","observation_id":"b9491dfe-a3c9-402a-b6e3-5f49c86cb9f2","resolution":{"observed_at":"2026-08-07T12:34:27.602865Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:34:31.479953Z","title":"Grab: A dataset of whole-body human grasp- ing of objects","venue":null,"work_id":"bba0dea4-28be-4206-90cd-690eea6a35b2","year":2020},"citing_paper":{"arxiv_id":"2505.24315","last_updated":"2025-05-30T07:53:55Z","snapshot_observed_at":"2026-08-09T19:35:40.557870Z","submitted_at":"2025-05-30T07:53:55Z","title":"InteractAnything: Zero-shot Human Object Interaction Synthesis via LLM Feedback and Object Affordance Parsing","version":1},"reference_index":53,"source":"pdf_text","source_observed_at":"2026-08-07T12:34:27.768966Z"},"links":{"citing_paper":"/paper/2505.24315"},"observation_digest":"sha256:db7c28369f0caf29cd72c8346ca27892acc9406af09fd54294f09684b337f7f3","observation_id":"2b8f938f-af8b-4b38-a23c-9cc77089cb9b","resolution":{"observed_at":"2026-08-07T12:34:31.585735Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:34:31.273284Z","title":"Deco: Dense estimation of 3d human-scene contact in the wild","venue":null,"work_id":"c8d176f6-baf0-43df-983c-250dd04f7a7b","year":2023},"citing_paper":{"arxiv_id":"2505.24315","last_updated":"2025-05-30T07:53:55Z","snapshot_observed_at":"2026-08-09T19:35:40.557870Z","submitted_at":"2025-05-30T07:53:55Z","title":"InteractAnything: Zero-shot Human Object Interaction Synthesis via LLM Feedback and Object Affordance Parsing","version":1},"reference_index":54,"source":"pdf_text","source_observed_at":"2026-08-07T12:34:27.884374Z"},"links":{"citing_paper":"/paper/2505.24315"},"observation_digest":"sha256:d39fc33ccbfa1208f7067b0b68aa0481475b05d4ce2b73807a5b6ccf2b03b71d","observation_id":"fe2ab362-6919-4c58-a9c0-48cfeaaa4520","resolution":{"observed_at":"2026-08-07T12:34:31.365989Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:34:31.056085Z","title":"Reconstructing action- conditioned human-object interactions using commonsense knowledge priors","venue":null,"work_id":"30cf91b7-fa14-47b6-8fec-9f2a42d2dedf","year":2022},"citing_paper":{"arxiv_id":"2505.24315","last_updated":"2025-05-30T07:53:55Z","snapshot_observed_at":"2026-08-09T19:35:40.557870Z","submitted_at":"2025-05-30T07:53:55Z","title":"InteractAnything: Zero-shot Human Object Interaction Synthesis via LLM Feedback and Object Affordance Parsing","version":1},"reference_index":55,"source":"pdf_text","source_observed_at":"2026-08-07T12:34:28.017100Z"},"links":{"citing_paper":"/paper/2505.24315"},"observation_digest":"sha256:ff9fe235dcc388ec1a0d13987c35e05e3acf46c8104cff77aa741fd6f107ee9e","observation_id":"84a2b3ca-f727-45a8-8493-5ed17b81d512","resolution":{"observed_at":"2026-08-07T12:34:31.174759Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:34:30.895438Z","title":"Prolificdreamer: High-fidelity and diverse text-to-3d generation with variational score distilla- tion","venue":null,"work_id":"8b99b5e9-5ba8-4f6f-acc9-c310bac31156","year":2024},"citing_paper":{"arxiv_id":"2505.24315","last_updated":"2025-05-30T07:53:55Z","snapshot_observed_at":"2026-08-09T19:35:40.557870Z","submitted_at":"2025-05-30T07:53:55Z","title":"InteractAnything: Zero-shot Human Object Interaction Synthesis via LLM Feedback and Object Affordance Parsing","version":1},"reference_index":56,"source":"pdf_text","source_observed_at":"2026-08-07T12:34:28.082526Z"},"links":{"citing_paper":"/paper/2505.24315"},"observation_digest":"sha256:4d9f2da6dee2070ca8fd1fb979310538e083482ae0c6af022b734e6267fdf4c7","observation_id":"b1fcb357-2409-466d-a9fe-5edfb4387425","resolution":{"observed_at":"2026-08-07T12:34:30.960475Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:34:30.689660Z","title":"Srinivasan, Jonathan T","venue":null,"work_id":"50134bb8-0c9c-412b-92b4-4c2a25f3d454","year":2022},"citing_paper":{"arxiv_id":"2505.24315","last_updated":"2025-05-30T07:53:55Z","snapshot_observed_at":"2026-08-09T19:35:40.557870Z","submitted_at":"2025-05-30T07:53:55Z","title":"InteractAnything: Zero-shot Human Object Interaction Synthesis via LLM Feedback and Object Affordance Parsing","version":1},"reference_index":57,"source":"pdf_text","source_observed_at":"2026-08-07T12:34:28.169610Z"},"links":{"citing_paper":"/paper/2505.24315"},"observation_digest":"sha256:dd81fe7a5611e5102a5f5f7e97cf3df79740a04c2c745bfe28cb17507e15796e","observation_id":"afe0f078-1466-4864-924c-163e3339cc7e","resolution":{"observed_at":"2026-08-07T12:34:30.801500Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:34:30.487733Z","title":"InterDiff: Generating 3d human-object interactions with physics-informed diffusion","venue":null,"work_id":"1741cee6-5e69-4bdb-91e2-2c0c44945474","year":2023},"citing_paper":{"arxiv_id":"2505.24315","last_updated":"2025-05-30T07:53:55Z","snapshot_observed_at":"2026-08-09T19:35:40.557870Z","submitted_at":"2025-05-30T07:53:55Z","title":"InteractAnything: Zero-shot Human Object Interaction Synthesis via LLM Feedback and Object Affordance Parsing","version":1},"reference_index":58,"source":"pdf_text","source_observed_at":"2026-08-07T12:34:28.258850Z"},"links":{"citing_paper":"/paper/2505.24315"},"observation_digest":"sha256:373e0ea39679f0f11636d142e794f4efa8a6f50d707bd7ad21dbefc4424c1f2d","observation_id":"587b5ae1-8250-4907-af46-655f05e25e3a","resolution":{"observed_at":"2026-08-07T12:34:30.570897Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:34:30.344511Z","title":"Inter- dreamer: Zero-shot text to 3d dynamic human-object inter- action.Advances in Neural Information Processing Systems, 37:52858–52890, 2024","venue":null,"work_id":"317aa923-3c69-44a0-b5dd-9589fd662acf","year":2024},"citing_paper":{"arxiv_id":"2505.24315","last_updated":"2025-05-30T07:53:55Z","snapshot_observed_at":"2026-08-09T19:35:40.557870Z","submitted_at":"2025-05-30T07:53:55Z","title":"InteractAnything: Zero-shot Human Object Interaction Synthesis via LLM Feedback and Object Affordance Parsing","version":1},"reference_index":59,"source":"pdf_text","source_observed_at":"2026-08-07T12:34:28.348072Z"},"links":{"citing_paper":"/paper/2505.24315"},"observation_digest":"sha256:e2943f6ee4b9d96f1b945e8d3b0e10c410febf0e622134cd2f27d37da854b128","observation_id":"a47186b5-86ad-4e1c-a459-0cae0765b661","resolution":{"observed_at":"2026-08-07T12:34:30.407736Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:34:30.178312Z","title":"Generating human interaction motions in scenes with text control","venue":null,"work_id":"e54cccac-514d-414a-993c-f7769457c3a4","year":2025},"citing_paper":{"arxiv_id":"2505.24315","last_updated":"2025-05-30T07:53:55Z","snapshot_observed_at":"2026-08-09T19:35:40.557870Z","submitted_at":"2025-05-30T07:53:55Z","title":"InteractAnything: Zero-shot Human Object Interaction Synthesis via LLM Feedback and Object Affordance Parsing","version":1},"reference_index":60,"source":"pdf_text","source_observed_at":"2026-08-07T12:34:28.436864Z"},"links":{"citing_paper":"/paper/2505.24315"},"observation_digest":"sha256:4c1b591f20a674cd44ae0f15d79942e7dcc47e4cc2fb56c2b2b688a8a2dd7a77","observation_id":"ac0d31af-10aa-4bd3-b25d-b99ebcf4f78d","resolution":{"observed_at":"2026-08-07T12:34:30.258402Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:34:30.037255Z","title":"Whac: World-grounded hu- mans and cameras","venue":null,"work_id":"c4913a37-e175-4858-b1f4-ab8aaf22545b","year":2024},"citing_paper":{"arxiv_id":"2505.24315","last_updated":"2025-05-30T07:53:55Z","snapshot_observed_at":"2026-08-09T19:35:40.557870Z","submitted_at":"2025-05-30T07:53:55Z","title":"InteractAnything: Zero-shot Human Object Interaction Synthesis via LLM Feedback and Object Affordance Parsing","version":1},"reference_index":61,"source":"pdf_text","source_observed_at":"2026-08-07T12:34:28.526428Z"},"links":{"citing_paper":"/paper/2505.24315"},"observation_digest":"sha256:cca8c83bd9792ca5af37134094fdfcab821c3a665637a1615f26f812ab32f74e","observation_id":"710b7347-e420-4c29-be77-3c537a0bd735","resolution":{"observed_at":"2026-08-07T12:34:30.101571Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:34:29.926186Z","title":"Pymaf-x: To- wards well-aligned full-body model regression from monoc- ular images.IEEE Transactions on Pattern Analysis and Ma- chine Intelligence, 45:12287–12303, 2023","venue":null,"work_id":"ff8da1ce-c765-4630-8329-324dbb5aa53e","year":2023},"citing_paper":{"arxiv_id":"2505.24315","last_updated":"2025-05-30T07:53:55Z","snapshot_observed_at":"2026-08-09T19:35:40.557870Z","submitted_at":"2025-05-30T07:53:55Z","title":"InteractAnything: Zero-shot Human Object Interaction Synthesis via LLM Feedback and Object Affordance Parsing","version":1},"reference_index":62,"source":"pdf_text","source_observed_at":"2026-08-07T12:34:28.616790Z"},"links":{"citing_paper":"/paper/2505.24315"},"observation_digest":"sha256:ed056ba65c6bac56dcadfab29d2cb95d99421d361df503e33ba6c72248e4835c","observation_id":"b0afaa77-f5aa-4018-a077-eaa6d79be4b8","resolution":{"observed_at":"2026-08-07T12:34:29.987265Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:34:29.739825Z","title":"Mixste: Seq2seq mixed spatio-temporal encoder for 3d human pose estimation in video","venue":null,"work_id":"91e029db-a5b0-4043-bdbc-78c911012a9b","year":2022},"citing_paper":{"arxiv_id":"2505.24315","last_updated":"2025-05-30T07:53:55Z","snapshot_observed_at":"2026-08-09T19:35:40.557870Z","submitted_at":"2025-05-30T07:53:55Z","title":"InteractAnything: Zero-shot Human Object Interaction Synthesis via LLM Feedback and Object Affordance Parsing","version":1},"reference_index":63,"source":"pdf_text","source_observed_at":"2026-08-07T12:34:28.708144Z"},"links":{"citing_paper":"/paper/2505.24315"},"observation_digest":"sha256:39e7a99647be1974cf341c4d1d03273dad1d4deaaa86d49c54ca57415a130a26","observation_id":"40014f15-d665-4c88-8bb5-31ba1f88acf0","resolution":{"observed_at":"2026-08-07T12:34:29.823834Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:34:29.595596Z","title":"Zhang, Sam Pepose, Hanbyul Joo, Deva Ra- manan, Jitendra Malik, and Angjoo Kanazawa","venue":null,"work_id":"70665718-0ffc-4946-b7d7-0c7b59fe1500","year":2020},"citing_paper":{"arxiv_id":"2505.24315","last_updated":"2025-05-30T07:53:55Z","snapshot_observed_at":"2026-08-09T19:35:40.557870Z","submitted_at":"2025-05-30T07:53:55Z","title":"InteractAnything: Zero-shot Human Object Interaction Synthesis via LLM Feedback and Object Affordance Parsing","version":1},"reference_index":64,"source":"pdf_text","source_observed_at":"2026-08-07T12:34:28.796048Z"},"links":{"citing_paper":"/paper/2505.24315"},"observation_digest":"sha256:c46c1c766cd234fb5d57d8767064079ac076bd93ae882746fcffff8186d47e1c","observation_id":"6849bd03-f493-4da2-a4df-71ec36508100","resolution":{"observed_at":"2026-08-07T12:34:29.657900Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:34:29.443619Z","title":"Humannerf: Efficiently gen- erated human radiance field from sparse inputs","venue":null,"work_id":"dd1a5f91-bdfe-4521-b8e1-06fca1f47889","year":2022},"citing_paper":{"arxiv_id":"2505.24315","last_updated":"2025-05-30T07:53:55Z","snapshot_observed_at":"2026-08-09T19:35:40.557870Z","submitted_at":"2025-05-30T07:53:55Z","title":"InteractAnything: Zero-shot Human Object Interaction Synthesis via LLM Feedback and Object Affordance Parsing","version":1},"reference_index":65,"source":"pdf_text","source_observed_at":"2026-08-07T12:34:28.886355Z"},"links":{"citing_paper":"/paper/2505.24315"},"observation_digest":"sha256:21896bc9be53df5ea0ead611c2b0a54c378af363a81ef496ac0213af3941d04d","observation_id":"2138a9dd-6f82-4e15-a8dc-062ead5f4573","resolution":{"observed_at":"2026-08-07T12:34:29.503854Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:34:29.298103Z","title":null,"venue":null,"work_id":"745b52da-a7dc-4511-aace-236d0e8405d6","year":2021},"citing_paper":{"arxiv_id":"2505.24315","last_updated":"2025-05-30T07:53:55Z","snapshot_observed_at":"2026-08-09T19:35:40.557870Z","submitted_at":"2025-05-30T07:53:55Z","title":"InteractAnything: Zero-shot Human Object Interaction Synthesis via LLM Feedback and Object Affordance Parsing","version":1},"reference_index":66,"source":"pdf_text","source_observed_at":"2026-08-07T12:34:28.952591Z"},"links":{"citing_paper":"/paper/2505.24315"},"observation_digest":"sha256:b8d42dd21edaf9e935ffc1581b4ed468352076e3bcc424b44f2db50c206376cb","observation_id":"e50db607-bbad-4cac-a0c6-08cc28e3d6ff","resolution":{"observed_at":"2026-08-07T12:34:29.351635Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2409.08278","last_updated":"2024-09-12T17:59:49Z","snapshot_observed_at":"2026-07-06T19:14:33.669810Z","submitted_at":"2024-09-12T17:59:49Z","title":"DreamHOI: Subject-Driven Generation of 3D Human-Object Interactions with Diffusion Priors","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2409.08278","snapshot_observed_at":"2026-08-07T12:34:29.029262Z","title":"Dreamhoi: Subject-driven generation of 3d human- object interactions with diffusion priors.arXiv preprint arXiv:2409.08278, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.24315","last_updated":"2025-05-30T07:53:55Z","snapshot_observed_at":"2026-08-09T19:35:40.557870Z","submitted_at":"2025-05-30T07:53:55Z","title":"InteractAnything: Zero-shot Human Object Interaction Synthesis via LLM Feedback and Object Affordance Parsing","version":1},"reference_index":67,"source":"pdf_text","source_observed_at":"2026-08-07T12:34:29.029262Z"},"links":{"cited_paper":"/paper/2409.08278","citing_paper":"/paper/2505.24315"},"observation_digest":"sha256:0d0d12cbcdc0a6fe19d27fd2c24121b8d0133c7a46a4345d0de5802e35f5287e","observation_id":"525fa60a-83ae-4851-bc7e-07f822574b16","resolution":{"observed_at":"2026-08-07T12:34:29.029262Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"paper":{"arxiv_id":"2505.24315","last_updated":"2025-05-30T07:53:55Z","latest_version":1,"primary_category":"cs.CV","snapshot_observed_at":"2026-08-09T19:35:40.557870Z","submitted_at":"2025-05-30T07:53:55Z","title":"InteractAnything: Zero-shot Human Object Interaction Synthesis via LLM Feedback and Object Affordance Parsing"},"reference_resolution":{"displayed":67,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":21,"verified_exact":0,"verified_fuzzy":46},"total_outbound_references":67},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"thesis":"As of 10 August 2026, this Paper Citation Record lists 67 of 67 outbound references and 0 inbound Pith citation observations for arXiv:2505.24315."}