{"as_of":"2026-08-23T00:29:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:d51d04a54a39f7d0f8c386fac196026fc893abea5881e9130b958762d84f24bd","coverage":[{"denominator":76,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":76,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-12T10:32:43.146958Z","state":"measured"},{"denominator":85,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":85,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-22T06:32:14.747728+00:00","state":"measured"},{"denominator":9,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":9,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-02T03:25:28.082379Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"pith","source_observed_at":"2026-07-10T23:27:38.901330Z","state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2411.19167","last_updated":"2025-04-30T13:32:06Z","snapshot_observed_at":"2026-08-14T04:48:32.710988Z","submitted_at":"2024-11-28T14:09:42Z","title":"HOT3D: Hand and Object Tracking in 3D from Egocentric Multi-View Videos","version":2},"cited_work":{"arxiv_id":"2411.19167","doi":null,"metadata_source":"pith","pith_arxiv_id":"2411.19167","snapshot_observed_at":"2026-07-10T23:27:38.901330Z","title":"Hot3d: Hand and object tracking in 3d from egocentric multi-view videos.arXiv preprint arXiv:2411.19167","venue":"cs.CV","work_id":"786567af-8f37-4dee-a9b1-fa28d954fea4","year":2024},"citing_paper":{"arxiv_id":"2505.07813","last_updated":"2026-05-17T22:14:58Z","snapshot_observed_at":"2026-07-06T21:22:45.982350Z","submitted_at":"2025-05-12T17:59:05Z","title":"DexWild: Dexterous Human Interactions for In-the-Wild Robot Policies","version":2},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-05-22T15:21:21.778285Z"},"links":{"cited_paper":"/paper/2411.19167","citing_paper":"/paper/2505.07813"},"observation_digest":"sha256:b1312edf55d0d7ee57ef0e6695f4ebadcd05153b31282f4e2a6ec3675d9da072","observation_id":"78b9cbe5-c153-4c62-889c-2178f7e702cf","resolution":{"observed_at":"2026-05-22T15:21:44.600081Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2411.19167","last_updated":"2025-04-30T13:32:06Z","snapshot_observed_at":"2026-08-14T04:48:32.710988Z","submitted_at":"2024-11-28T14:09:42Z","title":"HOT3D: Hand and Object Tracking in 3D from Egocentric Multi-View Videos","version":2},"cited_work":{"arxiv_id":"2411.19167","doi":null,"metadata_source":"pith","pith_arxiv_id":"2411.19167","snapshot_observed_at":"2026-07-10T23:27:38.901330Z","title":"Hot3d: Hand and object tracking in 3d from egocentric multi-view videos.arXiv preprint arXiv:2411.19167","venue":"cs.CV","work_id":"786567af-8f37-4dee-a9b1-fa28d954fea4","year":2024},"citing_paper":{"arxiv_id":"2508.00088","last_updated":"2025-07-31T18:28:07Z","snapshot_observed_at":"2026-08-02T11:33:42.077487Z","submitted_at":"2025-07-31T18:28:07Z","title":"The Monado SLAM Dataset for Egocentric Visual-Inertial Tracking","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-05-19T01:22:10.478937Z"},"links":{"cited_paper":"/paper/2411.19167","citing_paper":"/paper/2508.00088"},"observation_digest":"sha256:e58ad7bef25503a8f3b6f0703b088efeef624d9d9fe1e6f22f9c516a3b9753c7","observation_id":"c20e3de1-eb0a-4bcf-8801-f2c588b34579","resolution":{"observed_at":"2026-05-19T01:22:55.325099Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2411.19167","last_updated":"2025-04-30T13:32:06Z","snapshot_observed_at":"2026-08-14T04:48:32.710988Z","submitted_at":"2024-11-28T14:09:42Z","title":"HOT3D: Hand and Object Tracking in 3D from Egocentric Multi-View Videos","version":2},"cited_work":{"arxiv_id":"2411.19167","doi":null,"metadata_source":"pith","pith_arxiv_id":"2411.19167","snapshot_observed_at":"2026-07-10T23:27:38.901330Z","title":"Hot3d: Hand and object tracking in 3d from egocentric multi-view videos.arXiv preprint arXiv:2411.19167","venue":"cs.CV","work_id":"786567af-8f37-4dee-a9b1-fa28d954fea4","year":2024},"citing_paper":{"arxiv_id":"2511.12878","last_updated":"2026-05-11T01:22:42Z","snapshot_observed_at":"2026-08-22T03:17:29.737943Z","submitted_at":"2025-11-17T02:14:13Z","title":"Uni-Hand: Universal Hand Motion Forecasting in Egocentric Views","version":4},"reference_index":69,"source":"pdf_text","source_observed_at":"2026-05-17T22:31:13.391859Z"},"links":{"cited_paper":"/paper/2411.19167","citing_paper":"/paper/2511.12878"},"observation_digest":"sha256:7b9cf724866a08d880758b5589593ca34a8017a327601516509ad778ae0d9a76","observation_id":"119336e0-e7fb-4df6-b7be-f06822ee5ae3","resolution":{"observed_at":"2026-05-17T22:32:10.969366Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2411.19167","last_updated":"2025-04-30T13:32:06Z","snapshot_observed_at":"2026-08-14T04:48:32.710988Z","submitted_at":"2024-11-28T14:09:42Z","title":"HOT3D: Hand and Object Tracking in 3D from Egocentric Multi-View Videos","version":2},"cited_work":{"arxiv_id":"2411.19167","doi":null,"metadata_source":"pith","pith_arxiv_id":"2411.19167","snapshot_observed_at":"2026-07-10T23:27:38.901330Z","title":"Hot3d: Hand and object tracking in 3d from egocentric multi-view videos.arXiv preprint arXiv:2411.19167","venue":"cs.CV","work_id":"786567af-8f37-4dee-a9b1-fa28d954fea4","year":2024},"citing_paper":{"arxiv_id":"2605.03637","last_updated":"2026-05-05T11:09:41Z","snapshot_observed_at":"2026-08-11T15:47:39.031148Z","submitted_at":"2026-05-05T11:09:41Z","title":"Bridging the Embodiment Gap: Disentangled Cross-Embodiment Video Editing","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-05-07T15:44:25.021995Z"},"links":{"cited_paper":"/paper/2411.19167","citing_paper":"/paper/2605.03637"},"observation_digest":"sha256:6a55b2a5b5be23483a126995e3d17a2b6092762026f983b3f15306d4942d6218","observation_id":"096874db-3c42-467f-8d73-433da61f372e","resolution":{"observed_at":"2026-05-12T11:01:31.542416Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2411.19167","last_updated":"2025-04-30T13:32:06Z","snapshot_observed_at":"2026-08-14T04:48:32.710988Z","submitted_at":"2024-11-28T14:09:42Z","title":"HOT3D: Hand and Object Tracking in 3D from Egocentric Multi-View Videos","version":2},"cited_work":{"arxiv_id":"2411.19167","doi":null,"metadata_source":"pith","pith_arxiv_id":"2411.19167","snapshot_observed_at":"2026-07-10T23:27:38.901330Z","title":"Hot3d: Hand and object tracking in 3d from egocentric multi-view videos.arXiv preprint arXiv:2411.19167","venue":"cs.CV","work_id":"786567af-8f37-4dee-a9b1-fa28d954fea4","year":2024},"citing_paper":{"arxiv_id":"2605.12090","last_updated":"2026-05-12T13:10:52Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2026-05-12T13:10:52Z","title":"World Action Models: The Next Frontier in Embodied AI","version":1},"reference_index":192,"source":"pdf_text","source_observed_at":"2026-05-13T05:01:16.802019Z"},"links":{"cited_paper":"/paper/2411.19167","citing_paper":"/paper/2605.12090"},"observation_digest":"sha256:c9eadd985efc3d07ff45171a1238b186f3de4856e8dff4bf6e84ea902336878a","observation_id":"d09eb1d0-5b28-4f27-b5f8-dd51c4401727","resolution":{"observed_at":"2026-05-13T05:07:17.842985Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2411.19167","last_updated":"2025-04-30T13:32:06Z","snapshot_observed_at":"2026-08-14T04:48:32.710988Z","submitted_at":"2024-11-28T14:09:42Z","title":"HOT3D: Hand and Object Tracking in 3D from Egocentric Multi-View Videos","version":2},"cited_work":{"arxiv_id":"2411.19167","doi":null,"metadata_source":"pith","pith_arxiv_id":"2411.19167","snapshot_observed_at":"2026-07-10T23:27:38.901330Z","title":"Hot3d: Hand and object tracking in 3d from egocentric multi-view videos.arXiv preprint arXiv:2411.19167","venue":"cs.CV","work_id":"786567af-8f37-4dee-a9b1-fa28d954fea4","year":2024},"citing_paper":{"arxiv_id":"2606.08057","last_updated":"2026-06-06T08:39:52Z","snapshot_observed_at":"2026-08-13T19:03:22.319092Z","submitted_at":"2026-06-06T08:39:52Z","title":"EgoAERO: Learning Dexterous Manipulation from a Single Egocentric Video without Object Assets","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-06-27T19:50:51.089063Z"},"links":{"cited_paper":"/paper/2411.19167","citing_paper":"/paper/2606.08057"},"observation_digest":"sha256:800a4b706151d2e80fdc6704e15624257883cc95c18ab33e795af4a3971e1030","observation_id":"0c039414-3efd-4046-934e-7b9c48d8ab2a","resolution":{"observed_at":"2026-07-02T21:17:24.725846Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2411.19167","last_updated":"2025-04-30T13:32:06Z","snapshot_observed_at":"2026-08-14T04:48:32.710988Z","submitted_at":"2024-11-28T14:09:42Z","title":"HOT3D: Hand and Object Tracking in 3D from Egocentric Multi-View Videos","version":2},"cited_work":{"arxiv_id":"2411.19167","doi":null,"metadata_source":"pith","pith_arxiv_id":"2411.19167","snapshot_observed_at":"2026-07-10T23:27:38.901330Z","title":"Hot3d: Hand and object tracking in 3d from egocentric multi-view videos.arXiv preprint arXiv:2411.19167","venue":"cs.CV","work_id":"786567af-8f37-4dee-a9b1-fa28d954fea4","year":2024},"citing_paper":{"arxiv_id":"2607.02075","last_updated":"2026-08-14T13:15:06Z","snapshot_observed_at":"2026-08-19T23:09:21.524598Z","submitted_at":"2026-07-02T12:14:02Z","title":"HandsOnWorld: Unconstrained Egocentric Video Generation with Camera-Disentangled Hand Control","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-07-03T15:52:18.371702Z"},"links":{"cited_paper":"/paper/2411.19167","citing_paper":"/paper/2607.02075"},"observation_digest":"sha256:5469a908f94d26d6d56d6c8dec1eb34493ec35e4efcecdc953e195f57d580e91","observation_id":"4645ba2d-b552-49c5-932b-cb2ff49eaeae","resolution":{"observed_at":"2026-07-03T15:58:37.544783Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2411.19167","last_updated":"2025-04-30T13:32:06Z","snapshot_observed_at":"2026-08-14T04:48:32.710988Z","submitted_at":"2024-11-28T14:09:42Z","title":"HOT3D: Hand and Object Tracking in 3D from Egocentric Multi-View Videos","version":2},"cited_work":{"arxiv_id":"2411.19167","doi":null,"metadata_source":"pith","pith_arxiv_id":"2411.19167","snapshot_observed_at":"2026-07-10T23:27:38.901330Z","title":"Hot3d: Hand and object tracking in 3d from egocentric multi-view videos.arXiv preprint arXiv:2411.19167","venue":"cs.CV","work_id":"786567af-8f37-4dee-a9b1-fa28d954fea4","year":2024},"citing_paper":{"arxiv_id":"2607.06691","last_updated":"2026-07-07T18:08:45Z","snapshot_observed_at":"2026-08-20T05:22:27.296877Z","submitted_at":"2026-07-07T18:08:45Z","title":"CoMind: Understanding Collaborative Human Activity from Multiple Minds and Views","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-07-10T23:20:12.870365Z"},"links":{"cited_paper":"/paper/2411.19167","citing_paper":"/paper/2607.06691"},"observation_digest":"sha256:c3fb024d46cfee22e2650e8cd96527d14b59b53dd86f38672e184b92f5717a1f","observation_id":"c8b62a83-8eab-476e-89b2-ad4653c0b46a","resolution":{"observed_at":"2026-07-10T23:27:38.917865Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2411.19167","last_updated":"2025-04-30T13:32:06Z","snapshot_observed_at":"2026-08-14T04:48:32.710988Z","submitted_at":"2024-11-28T14:09:42Z","title":"HOT3D: Hand and Object Tracking in 3D from Egocentric Multi-View Videos","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2411.19167","snapshot_observed_at":"2026-08-02T03:25:28.082379Z","title":"HOT3D: Hand and object tracking in 3d from egocentric multi-view videos","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.14183","last_updated":"2026-07-18T10:02:02Z","snapshot_observed_at":"2026-08-19T06:05:28.552729Z","submitted_at":"2026-07-15T14:49:49Z","title":"Open-AoE: An Open Egocentric Manipulation Dataset and Toolchain for Embodied Learning","version":2},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-02T03:25:28.082379Z"},"links":{"cited_paper":"/paper/2411.19167","citing_paper":"/paper/2607.14183"},"observation_digest":"sha256:e0301159734f7f17e2e8e29e8ab2b72748a0d72aaecdacb8e5c013f5977a32d7","observation_id":"201c368d-33d0-4166-bc5b-cbbd3e1127c0","resolution":{"observed_at":"2026-08-02T03:25:28.082379Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"links":{"evidence":"/evidence","html":"/paper/2411.19167/citation-record","integrity":"/paper/2411.19167/integrity","json":"/paper/2411.19167/citation-record.json","paper":"/paper/2411.19167"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T10:32:44.052372Z","title":"Crandall, and Chen Y u","venue":null,"work_id":"d7a71a95-f4d1-47f0-b119-df3d447e5e21","year":2015},"citing_paper":{"arxiv_id":"2411.19167","last_updated":"2025-04-30T13:32:06Z","snapshot_observed_at":"2026-08-14T04:48:32.710988Z","submitted_at":"2024-11-28T14:09:42Z","title":"HOT3D: Hand and Object Tracking in 3D from Egocentric Multi-View Videos","version":2},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-12T10:32:42.845914Z"},"links":{"citing_paper":"/paper/2411.19167"},"observation_digest":"sha256:df9214340fe3e409fb6442a9e95f9a7c1f029b0f5a7d715517e55b6325460ce2","observation_id":"6c14e01d-bee0-4435-ae85-c87fe21e6cac","resolution":{"observed_at":"2026-08-12T10:32:44.055476Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T10:32:44.040998Z","title":"The precision of the human hand: variability in pinch strength and manual dexterity.Symmetry, 2022","venue":null,"work_id":"0e2e6e7a-413b-4ee8-958c-af81bef00629","year":2022},"citing_paper":{"arxiv_id":"2411.19167","last_updated":"2025-04-30T13:32:06Z","snapshot_observed_at":"2026-08-14T04:48:32.710988Z","submitted_at":"2024-11-28T14:09:42Z","title":"HOT3D: Hand and Object Tracking in 3D from Egocentric Multi-View Videos","version":2},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-12T10:32:42.851233Z"},"links":{"citing_paper":"/paper/2411.19167"},"observation_digest":"sha256:3eab26313309cd759c5558f48820a19594f35ef4f83d88979006d0b72cd72f40","observation_id":"87e3e5e2-15ba-4014-a90a-2338f4684e90","resolution":{"observed_at":"2026-08-12T10:32:44.045415Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T10:32:44.029591Z","title":"BEHA VE: Dataset and method for tracking human object interactions","venue":null,"work_id":"eee4cea7-ab75-4be4-8529-7a531325c7de","year":2022},"citing_paper":{"arxiv_id":"2411.19167","last_updated":"2025-04-30T13:32:06Z","snapshot_observed_at":"2026-08-14T04:48:32.710988Z","submitted_at":"2024-11-28T14:09:42Z","title":"HOT3D: Hand and Object Tracking in 3D from Egocentric Multi-View Videos","version":2},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-12T10:32:42.855761Z"},"links":{"citing_paper":"/paper/2411.19167"},"observation_digest":"sha256:1b1e064f00a275da021219c5dda5ea8cad6b88640b0efd835aea5ca5df02d83d","observation_id":"1f4b7905-9e0e-4c0f-afdf-34c00952c862","resolution":{"observed_at":"2026-08-12T10:32:44.033457Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T10:32:44.017645Z","title":"Learning OpenCV: Computer vision with the OpenCV library.O’REILLY, 2008","venue":null,"work_id":"30b59a5a-7447-43b9-9221-2dd2ea63192c","year":2008},"citing_paper":{"arxiv_id":"2411.19167","last_updated":"2025-04-30T13:32:06Z","snapshot_observed_at":"2026-08-14T04:48:32.710988Z","submitted_at":"2024-11-28T14:09:42Z","title":"HOT3D: Hand and Object Tracking in 3D from Egocentric Multi-View Videos","version":2},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-12T10:32:42.860461Z"},"links":{"citing_paper":"/paper/2411.19167"},"observation_digest":"sha256:09fefa3a4a8dd58c376562e6f5f5c377979e94a6a46600ebef2999a21dd31c02","observation_id":"d63c10ac-3834-4714-84ad-13201068b750","resolution":{"observed_at":"2026-08-12T10:32:44.021625Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T10:32:44.006477Z","title":"ContactPose: A dataset of grasps with object contact and hand pose","venue":null,"work_id":"194bc771-4742-4fd8-a511-bb6036118e2e","year":2020},"citing_paper":{"arxiv_id":"2411.19167","last_updated":"2025-04-30T13:32:06Z","snapshot_observed_at":"2026-08-14T04:48:32.710988Z","submitted_at":"2024-11-28T14:09:42Z","title":"HOT3D: Hand and Object Tracking in 3D from Egocentric Multi-View Videos","version":2},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-12T10:32:42.864445Z"},"links":{"citing_paper":"/paper/2411.19167"},"observation_digest":"sha256:341898a95f6077328c18ee23f0e2785ac346cb5f0e5e0e7680d6c7aefb28afae","observation_id":"940d2ae7-d1e1-4ee5-a68b-6b894e4ef3ea","resolution":{"observed_at":"2026-08-12T10:32:44.010142Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T10:32:43.994970Z","title":"Bullock, Thomas Feix, and Aaron M","venue":null,"work_id":"522fc600-e14f-433a-b68b-a231afbf2a6f","year":2015},"citing_paper":{"arxiv_id":"2411.19167","last_updated":"2025-04-30T13:32:06Z","snapshot_observed_at":"2026-08-14T04:48:32.710988Z","submitted_at":"2024-11-28T14:09:42Z","title":"HOT3D: Hand and Object Tracking in 3D from Egocentric Multi-View Videos","version":2},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-12T10:32:42.867941Z"},"links":{"citing_paper":"/paper/2411.19167"},"observation_digest":"sha256:51df4fa5c695056b944da567a77443231179c8b0181443effa95e306506263c3","observation_id":"daa05db1-0866-46f9-8c36-208232e2b63d","resolution":{"observed_at":"2026-08-12T10:32:43.998930Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T10:32:43.983448Z","title":"The YCV object and model set: Towards common benchmarks for manipulation research","venue":null,"work_id":"10de58c8-923d-44eb-9a55-b67867713a04","year":2015},"citing_paper":{"arxiv_id":"2411.19167","last_updated":"2025-04-30T13:32:06Z","snapshot_observed_at":"2026-08-14T04:48:32.710988Z","submitted_at":"2024-11-28T14:09:42Z","title":"HOT3D: Hand and Object Tracking in 3D from Egocentric Multi-View Videos","version":2},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-12T10:32:42.872204Z"},"links":{"citing_paper":"/paper/2411.19167"},"observation_digest":"sha256:3d6919d6845391afb761346f6930a1968d36463938242f7d46e556ba28ac4727","observation_id":"d4d9b3a3-97ec-4049-a63c-c998afcaf59e","resolution":{"observed_at":"2026-08-12T10:32:43.987465Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T10:32:43.970431Z","title":"Narang, Karl V an Wyk, Umar Iqbal, Stan Birchfield, Jan Kautz, and Dieter Fox","venue":null,"work_id":"2b208050-d8a8-4f43-8411-9a35648ae5b0","year":null},"citing_paper":{"arxiv_id":"2411.19167","last_updated":"2025-04-30T13:32:06Z","snapshot_observed_at":"2026-08-14T04:48:32.710988Z","submitted_at":"2024-11-28T14:09:42Z","title":"HOT3D: Hand and Object Tracking in 3D from Egocentric Multi-View Videos","version":2},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-12T10:32:42.876472Z"},"links":{"citing_paper":"/paper/2411.19167"},"observation_digest":"sha256:95ee04e13537e0fdfbebc5487b27c26c81f4f83250cb0976d39b3ba9f9c37e60","observation_id":"c08ecfe3-2fd0-4cc9-b718-29f8012c5c97","resolution":{"observed_at":"2026-08-12T10:32:43.974969Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T10:32:43.959211Z","title":"Dense hand-object(HO) GraspNet with full grasping taxonomy and dynamics","venue":null,"work_id":"2cecf11f-00ac-498a-b691-e8b219a6acb9","year":2024},"citing_paper":{"arxiv_id":"2411.19167","last_updated":"2025-04-30T13:32:06Z","snapshot_observed_at":"2026-08-14T04:48:32.710988Z","submitted_at":"2024-11-28T14:09:42Z","title":"HOT3D: Hand and Object Tracking in 3D from Egocentric Multi-View Videos","version":2},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-12T10:32:42.880200Z"},"links":{"citing_paper":"/paper/2411.19167"},"observation_digest":"sha256:38816e712943c9449868d63483994f3e6f99a38c68199a3c819bad5a3407637c","observation_id":"6288140e-06e7-44e2-8e7f-4561d1d3733b","resolution":{"observed_at":"2026-08-12T10:32:43.962957Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T10:32:43.947277Z","title":"Rescaling egocentric vision: Collection, pipeline and challenges for EPIC-KITCHENS-100.IJCV, 2022","venue":null,"work_id":"433dfbbf-c942-4f31-8ffc-6c823e202c3b","year":2022},"citing_paper":{"arxiv_id":"2411.19167","last_updated":"2025-04-30T13:32:06Z","snapshot_observed_at":"2026-08-14T04:48:32.710988Z","submitted_at":"2024-11-28T14:09:42Z","title":"HOT3D: Hand and Object Tracking in 3D from Egocentric Multi-View Videos","version":2},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-12T10:32:42.883703Z"},"links":{"citing_paper":"/paper/2411.19167"},"observation_digest":"sha256:6c38d61051acefe03ad21ef82935c334b9aa6c83bb6ea7f68e9e0663fbcceac0","observation_id":"abec6256-4a3b-4c0b-b304-eb5393872d4e","resolution":{"observed_at":"2026-08-12T10:32:43.951445Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T10:32:43.934962Z","title":"BlenderProc: Reducing the reality gap with photorealistic rendering","venue":null,"work_id":"92b651cb-8dc6-4757-82e6-89c66014f8e7","year":2020},"citing_paper":{"arxiv_id":"2411.19167","last_updated":"2025-04-30T13:32:06Z","snapshot_observed_at":"2026-08-14T04:48:32.710988Z","submitted_at":"2024-11-28T14:09:42Z","title":"HOT3D: Hand and Object Tracking in 3D from Egocentric Multi-View Videos","version":2},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-12T10:32:42.886636Z"},"links":{"citing_paper":"/paper/2411.19167"},"observation_digest":"sha256:34d8fd5cfdd488040da7e8968a0a45a736e5ffcb0c22e12eccd4ec808c952190","observation_id":"2f8c76f7-f733-4c98-b776-2c8c710540c8","resolution":{"observed_at":"2026-08-12T10:32:43.939006Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1911.01911","last_updated":"2019-10-25T16:53:12Z","snapshot_observed_at":"2026-08-20T12:53:14.387643Z","submitted_at":"2019-10-25T16:53:12Z","title":"BlenderProc","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1911.01911","snapshot_observed_at":"2026-08-12T10:32:42.890494Z","title":"Blenderproc","venue":null,"work_id":null,"year":1911},"citing_paper":{"arxiv_id":"2411.19167","last_updated":"2025-04-30T13:32:06Z","snapshot_observed_at":"2026-08-14T04:48:32.710988Z","submitted_at":"2024-11-28T14:09:42Z","title":"HOT3D: Hand and Object Tracking in 3D from Egocentric Multi-View Videos","version":2},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-12T10:32:42.890494Z"},"links":{"cited_paper":"/paper/1911.01911","citing_paper":"/paper/2411.19167"},"observation_digest":"sha256:dcd82b5871847409f2db4b25226745bff52156724a67f34f6823a94cb1264d09","observation_id":"472281b6-4736-43c2-bb57-9012081091fe","resolution":{"observed_at":"2026-08-12T10:32:42.890494Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T10:32:43.923010Z","title":"Project Aria: A new tool for egocentric multi-modal AI research, 2023","venue":null,"work_id":"2b07aed4-55f6-46f9-9ba7-81c1b8bcdb00","year":2023},"citing_paper":{"arxiv_id":"2411.19167","last_updated":"2025-04-30T13:32:06Z","snapshot_observed_at":"2026-08-14T04:48:32.710988Z","submitted_at":"2024-11-28T14:09:42Z","title":"HOT3D: Hand and Object Tracking in 3D from Egocentric Multi-View Videos","version":2},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-12T10:32:42.895053Z"},"links":{"citing_paper":"/paper/2411.19167"},"observation_digest":"sha256:c38f7fe5c3ba7c425d06a49bcf91d0cf228e667d30cda2ae37b47bf66078d3b1","observation_id":"c47873e2-e663-48e0-9854-3b7d528e5b9e","resolution":{"observed_at":"2026-08-12T10:32:43.926959Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T10:32:43.912885Z","title":"The P ASCAL visual object classes (VOC) challenge.IJCV, 2010","venue":null,"work_id":"22048145-543a-4217-8f4e-8fcceec876aa","year":2010},"citing_paper":{"arxiv_id":"2411.19167","last_updated":"2025-04-30T13:32:06Z","snapshot_observed_at":"2026-08-14T04:48:32.710988Z","submitted_at":"2024-11-28T14:09:42Z","title":"HOT3D: Hand and Object Tracking in 3D from Egocentric Multi-View Videos","version":2},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-12T10:32:42.899070Z"},"links":{"citing_paper":"/paper/2411.19167"},"observation_digest":"sha256:fef00b7c71f67078d2f96c86483a04cc3a03f707c4e3f60b86e7bc8c0a5094df","observation_id":"0c00ec98-4978-42e6-8a1f-3d08226033cf","resolution":{"observed_at":"2026-08-12T10:32:43.916486Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T10:32:43.901553Z","title":"ARCTIC: A dataset for dexterous bimanual hand-object manipulation","venue":null,"work_id":"d6ca264d-6638-4407-8a3c-c708c4e2585b","year":2023},"citing_paper":{"arxiv_id":"2411.19167","last_updated":"2025-04-30T13:32:06Z","snapshot_observed_at":"2026-08-14T04:48:32.710988Z","submitted_at":"2024-11-28T14:09:42Z","title":"HOT3D: Hand and Object Tracking in 3D from Egocentric Multi-View Videos","version":2},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-12T10:32:42.902827Z"},"links":{"citing_paper":"/paper/2411.19167"},"observation_digest":"sha256:474f3c174a3ed4dd7143af13b35577b3faf40d67ff0a30893fce2444d5d57601","observation_id":"fa787609-c697-4b0b-bc3b-a58f617af21d","resolution":{"observed_at":"2026-08-12T10:32:43.905613Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T10:32:43.890106Z","title":null,"venue":null,"work_id":"406b9ec6-cdfc-4ec1-ab41-db4e279cd37d","year":2011},"citing_paper":{"arxiv_id":"2411.19167","last_updated":"2025-04-30T13:32:06Z","snapshot_observed_at":"2026-08-14T04:48:32.710988Z","submitted_at":"2024-11-28T14:09:42Z","title":"HOT3D: Hand and Object Tracking in 3D from Egocentric Multi-View Videos","version":2},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-12T10:32:42.906848Z"},"links":{"citing_paper":"/paper/2411.19167"},"observation_digest":"sha256:ed1cc2a2830476f5023cc1b4e822207d54dc102a90badafd85d07dabb26a254a","observation_id":"76e31cf9-3a59-4f6d-99b0-dead009e7f12","resolution":{"observed_at":"2026-08-12T10:32:43.894150Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T10:32:43.878685Z","title":"Category-level 6D object pose estimation in the wild: A semi-supervised learning approach and a new dataset","venue":null,"work_id":"e4b019ad-8707-47c3-901d-d596e3408d7a","year":2022},"citing_paper":{"arxiv_id":"2411.19167","last_updated":"2025-04-30T13:32:06Z","snapshot_observed_at":"2026-08-14T04:48:32.710988Z","submitted_at":"2024-11-28T14:09:42Z","title":"HOT3D: Hand and Object Tracking in 3D from Egocentric Multi-View Videos","version":2},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-12T10:32:42.911675Z"},"links":{"citing_paper":"/paper/2411.19167"},"observation_digest":"sha256:693f78f1b3ee49694480166f4b6664999e1e9e8f769519259b1a8fbc5754a25d","observation_id":"309ed033-5e4b-4a68-aa3b-b68996b7feb5","resolution":{"observed_at":"2026-08-12T10:32:43.882739Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T10:32:43.867896Z","title":"First-person hand action benchmark with RGB-D videos and 3D hand pose annotations","venue":null,"work_id":"fdd2e8db-8f29-42f8-a949-db3c481123e7","year":2018},"citing_paper":{"arxiv_id":"2411.19167","last_updated":"2025-04-30T13:32:06Z","snapshot_observed_at":"2026-08-14T04:48:32.710988Z","submitted_at":"2024-11-28T14:09:42Z","title":"HOT3D: Hand and Object Tracking in 3D from Egocentric Multi-View Videos","version":2},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-12T10:32:42.915469Z"},"links":{"citing_paper":"/paper/2411.19167"},"observation_digest":"sha256:5a920bea3e8815ca3cdaeda87753fd83790d5416862c5cc02251db3b85081c15","observation_id":"720f5fd4-0749-474d-86df-fc587e76e812","resolution":{"observed_at":"2026-08-12T10:32:43.872042Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T10:32:43.855935Z","title":"Are we ready for autonomous driving? The KITTI vision benchmark suite","venue":null,"work_id":"c1e60ea2-a59f-49fb-9be7-106be4c6e75d","year":2012},"citing_paper":{"arxiv_id":"2411.19167","last_updated":"2025-04-30T13:32:06Z","snapshot_observed_at":"2026-08-14T04:48:32.710988Z","submitted_at":"2024-11-28T14:09:42Z","title":"HOT3D: Hand and Object Tracking in 3D from Egocentric Multi-View Videos","version":2},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-12T10:32:42.919192Z"},"links":{"citing_paper":"/paper/2411.19167"},"observation_digest":"sha256:1f753aa8ec2f8c9241db0370a58158d4622cc112c509de6f59bd60ea5a6b30c6","observation_id":"b71a6f31-81a8-49b8-9c09-5fa3829d063d","resolution":{"observed_at":"2026-08-12T10:32:43.860187Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T10:32:43.844342Z","title":"Zero-shot category-level object pose estimation","venue":null,"work_id":"a8874274-950f-40e1-9990-11f39f67fb1b","year":2022},"citing_paper":{"arxiv_id":"2411.19167","last_updated":"2025-04-30T13:32:06Z","snapshot_observed_at":"2026-08-14T04:48:32.710988Z","submitted_at":"2024-11-28T14:09:42Z","title":"HOT3D: Hand and Object Tracking in 3D from Egocentric Multi-View Videos","version":2},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-12T10:32:42.923426Z"},"links":{"citing_paper":"/paper/2411.19167"},"observation_digest":"sha256:0cfda4ec46f4ac70dfbf1e562f3ae3c0b076ecfe42488acfe34314c122fbcd2c","observation_id":"1342304d-2a4a-4b04-b054-c386b6d11f8c","resolution":{"observed_at":"2026-08-12T10:32:43.848755Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T10:32:43.831520Z","title":"HANDAL: A dataset of real-world manipulable object categories with pose annotations, affordances, and reconstructions","venue":null,"work_id":"33b71ae0-1da1-42e6-b18a-383d80592807","year":2023},"citing_paper":{"arxiv_id":"2411.19167","last_updated":"2025-04-30T13:32:06Z","snapshot_observed_at":"2026-08-14T04:48:32.710988Z","submitted_at":"2024-11-28T14:09:42Z","title":"HOT3D: Hand and Object Tracking in 3D from Egocentric Multi-View Videos","version":2},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-12T10:32:42.927558Z"},"links":{"citing_paper":"/paper/2411.19167"},"observation_digest":"sha256:815aea923fc030d43b680f9a555de34d3ff4667bb5c499cd08056b73ff920216","observation_id":"c2672e10-c407-4b4f-88c6-747e0eb8516c","resolution":{"observed_at":"2026-08-12T10:32:43.836235Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T10:32:43.820729Z","title":"In-hand 3D object scanning from an RGB sequence","venue":null,"work_id":"86e92760-d528-4a82-85f9-2af6ac9dc3cd","year":2023},"citing_paper":{"arxiv_id":"2411.19167","last_updated":"2025-04-30T13:32:06Z","snapshot_observed_at":"2026-08-14T04:48:32.710988Z","submitted_at":"2024-11-28T14:09:42Z","title":"HOT3D: Hand and Object Tracking in 3D from Egocentric Multi-View Videos","version":2},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-12T10:32:42.931481Z"},"links":{"citing_paper":"/paper/2411.19167"},"observation_digest":"sha256:21756e52e01e46a01842e0e003abfb7bc52ba4741b6926cadb11a8c30d04c4b9","observation_id":"8b387717-ba6f-4c66-b3e3-d2ef80a3ae93","resolution":{"observed_at":"2026-08-12T10:32:43.824656Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T10:32:43.809345Z","title":"HOnnotate: A method for 3D annotation of hand and object poses","venue":null,"work_id":"b1a4ce23-4366-426d-9c2e-6ddec9bc713d","year":2020},"citing_paper":{"arxiv_id":"2411.19167","last_updated":"2025-04-30T13:32:06Z","snapshot_observed_at":"2026-08-14T04:48:32.710988Z","submitted_at":"2024-11-28T14:09:42Z","title":"HOT3D: Hand and Object Tracking in 3D from Egocentric Multi-View Videos","version":2},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-12T10:32:42.934796Z"},"links":{"citing_paper":"/paper/2411.19167"},"observation_digest":"sha256:a48ceaf9d8bd7040daeac36b9300579ebfa78382bb007b6302edc317916d06eb","observation_id":"7eccef35-fac0-494f-9213-fe1cba91c549","resolution":{"observed_at":"2026-08-12T10:32:43.813503Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T10:32:43.797742Z","title":"Keypoint transformer: Solving joint identification in challenging hands and object interactions for accurate 3D pose estimation","venue":null,"work_id":"0fbf31e8-cce1-4c26-89c8-a96f68880c49","year":2022},"citing_paper":{"arxiv_id":"2411.19167","last_updated":"2025-04-30T13:32:06Z","snapshot_observed_at":"2026-08-14T04:48:32.710988Z","submitted_at":"2024-11-28T14:09:42Z","title":"HOT3D: Hand and Object Tracking in 3D from Egocentric Multi-View Videos","version":2},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-12T10:32:42.939133Z"},"links":{"citing_paper":"/paper/2411.19167"},"observation_digest":"sha256:211cfb42a668a0d000b9d9f8df3a9386fd8031b47b2b72d841ec833e0761691c","observation_id":"e2b74051-d950-4332-a40d-b47fcae26ce6","resolution":{"observed_at":"2026-08-12T10:32:43.801953Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T10:32:43.787035Z","title":"Twigg, and Kenrick Kin","venue":null,"work_id":"ac6a268b-086b-4f05-8d5a-e4950336e61d","year":2018},"citing_paper":{"arxiv_id":"2411.19167","last_updated":"2025-04-30T13:32:06Z","snapshot_observed_at":"2026-08-14T04:48:32.710988Z","submitted_at":"2024-11-28T14:09:42Z","title":"HOT3D: Hand and Object Tracking in 3D from Egocentric Multi-View Videos","version":2},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-08-12T10:32:42.942561Z"},"links":{"citing_paper":"/paper/2411.19167"},"observation_digest":"sha256:236d07c43777eb5b9d10008dc33f5cdc3b4e05098bf41427920750f79edec6a8","observation_id":"d8adb37c-102b-4fd9-a049-9b9c75e4575b","resolution":{"observed_at":"2026-08-12T10:32:43.790855Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T10:32:43.774951Z","title":"UmeTrack: Unified multi-view end-to-end hand tracking for VR","venue":null,"work_id":"903ad9fd-6720-416f-9c49-2d107cff72d2","year":2022},"citing_paper":{"arxiv_id":"2411.19167","last_updated":"2025-04-30T13:32:06Z","snapshot_observed_at":"2026-08-14T04:48:32.710988Z","submitted_at":"2024-11-28T14:09:42Z","title":"HOT3D: Hand and Object Tracking in 3D from Egocentric Multi-View Videos","version":2},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-08-12T10:32:42.946782Z"},"links":{"citing_paper":"/paper/2411.19167"},"observation_digest":"sha256:ef2c35a5ca8891c7aedcfb45db22f59987cbf89a5a4e052c958ccb5ea9324f8e","observation_id":"aada9d39-9851-4d1c-9fba-767acf596e55","resolution":{"observed_at":"2026-08-12T10:32:43.780143Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T10:32:43.763252Z","title":"Learning joint reconstruction of hands and manipulated objects","venue":null,"work_id":"cfef091c-7aa7-4465-ae1b-52170433a633","year":2019},"citing_paper":{"arxiv_id":"2411.19167","last_updated":"2025-04-30T13:32:06Z","snapshot_observed_at":"2026-08-14T04:48:32.710988Z","submitted_at":"2024-11-28T14:09:42Z","title":"HOT3D: Hand and Object Tracking in 3D from Egocentric Multi-View Videos","version":2},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-08-12T10:32:42.950778Z"},"links":{"citing_paper":"/paper/2411.19167"},"observation_digest":"sha256:e79bae9614be8bd8a0b1e4813c1b0fab5a98c02ca4b7ee144e53b25177d9b928","observation_id":"8bb87bbc-6239-4810-af52-9fa7e3a4c2d3","resolution":{"observed_at":"2026-08-12T10:32:43.767240Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T10:32:43.751292Z","title":"Mask R-CNN","venue":null,"work_id":"04cdaf71-fdfc-421f-9f83-4d6845044a1b","year":2017},"citing_paper":{"arxiv_id":"2411.19167","last_updated":"2025-04-30T13:32:06Z","snapshot_observed_at":"2026-08-14T04:48:32.710988Z","submitted_at":"2024-11-28T14:09:42Z","title":"HOT3D: Hand and Object Tracking in 3D from Egocentric Multi-View Videos","version":2},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-08-12T10:32:42.954828Z"},"links":{"citing_paper":"/paper/2411.19167"},"observation_digest":"sha256:c70bc750b90fd47a052dee42a7f7a5aa4eb08d22c7bc295fa01e5c0ed069b9bf","observation_id":"11d626e3-34e2-4863-9362-fc4005e47da5","resolution":{"observed_at":"2026-08-12T10:32:43.755665Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T10:32:43.738886Z","title":"Towards 3D hand tracking using a deformable model","venue":null,"work_id":"b4a20b42-04ee-4ddd-a77d-eac33931dd8a","year":1996},"citing_paper":{"arxiv_id":"2411.19167","last_updated":"2025-04-30T13:32:06Z","snapshot_observed_at":"2026-08-14T04:48:32.710988Z","submitted_at":"2024-11-28T14:09:42Z","title":"HOT3D: Hand and Object Tracking in 3D from Egocentric Multi-View Videos","version":2},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-08-12T10:32:42.958611Z"},"links":{"citing_paper":"/paper/2411.19167"},"observation_digest":"sha256:fd30db2e45fc032cb0f9c1f6a72219066daebca416e5adb9ac48f1a52f98cc49","observation_id":"27bcd177-1dd6-4bdc-884b-f964672b619d","resolution":{"observed_at":"2026-08-12T10:32:43.742869Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T10:32:43.727668Z","title":"Model based training, detection and pose estimation of texture-less 3D objects in heavily cluttered scenes","venue":null,"work_id":"bd9dcf27-47d2-42a2-9dbb-b63884d6b999","year":2013},"citing_paper":{"arxiv_id":"2411.19167","last_updated":"2025-04-30T13:32:06Z","snapshot_observed_at":"2026-08-14T04:48:32.710988Z","submitted_at":"2024-11-28T14:09:42Z","title":"HOT3D: Hand and Object Tracking in 3D from Egocentric Multi-View Videos","version":2},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-08-12T10:32:42.962304Z"},"links":{"citing_paper":"/paper/2411.19167"},"observation_digest":"sha256:44d9a0a95fa118f461af5fa0a2a110d4e68138e56a2cc66a8f4db3b0f51c51b7","observation_id":"4f087d96-f89e-4154-8b36-d6c05f64ada3","resolution":{"observed_at":"2026-08-12T10:32:43.731955Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T10:32:43.714413Z","title":"T -LESS: An RGB-D dataset for 6D pose estimation of texture-less objects.WACV, 2017","venue":null,"work_id":"86a9e93d-a2ae-4477-b267-5617792467de","year":2017},"citing_paper":{"arxiv_id":"2411.19167","last_updated":"2025-04-30T13:32:06Z","snapshot_observed_at":"2026-08-14T04:48:32.710988Z","submitted_at":"2024-11-28T14:09:42Z","title":"HOT3D: Hand and Object Tracking in 3D from Egocentric Multi-View Videos","version":2},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-08-12T10:32:42.966327Z"},"links":{"citing_paper":"/paper/2411.19167"},"observation_digest":"sha256:8b3d093ca12f409547060086d15e39a5f0e82de5953d60a4557a80e0c377c907","observation_id":"ebccb401-81e5-41d4-ae47-7be7ce87817a","resolution":{"observed_at":"2026-08-12T10:32:43.718827Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T10:32:43.703624Z","title":"BOP: Benchmark for 6D object pose estimation.ECCV, 2018","venue":null,"work_id":"ab7ac52b-13a5-47b4-a4f9-97eed88cb1fe","year":2018},"citing_paper":{"arxiv_id":"2411.19167","last_updated":"2025-04-30T13:32:06Z","snapshot_observed_at":"2026-08-14T04:48:32.710988Z","submitted_at":"2024-11-28T14:09:42Z","title":"HOT3D: Hand and Object Tracking in 3D from Egocentric Multi-View Videos","version":2},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-08-12T10:32:42.970305Z"},"links":{"citing_paper":"/paper/2411.19167"},"observation_digest":"sha256:9102c0b42702fd9f8cff86d48730bab419c086cb93c3fd183ccbeef0ee915d52","observation_id":"9982711e-707f-495c-b2f8-d0144da25f0e","resolution":{"observed_at":"2026-08-12T10:32:43.707361Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T10:32:43.691793Z","title":"BOP Challenge 2020 on 6D object localization","venue":null,"work_id":"844af0cf-8284-42af-b027-521d91b6f85a","year":2020},"citing_paper":{"arxiv_id":"2411.19167","last_updated":"2025-04-30T13:32:06Z","snapshot_observed_at":"2026-08-14T04:48:32.710988Z","submitted_at":"2024-11-28T14:09:42Z","title":"HOT3D: Hand and Object Tracking in 3D from Egocentric Multi-View Videos","version":2},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-08-12T10:32:42.974488Z"},"links":{"citing_paper":"/paper/2411.19167"},"observation_digest":"sha256:9e9f8bb8c1c4dd894e4f683edae8fd9b293d481f3fd37d5ebe7bf5a71157b4cf","observation_id":"f4d66b45-ee01-4c6f-b0bc-1622717428dc","resolution":{"observed_at":"2026-08-12T10:32:43.695983Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T10:32:43.679290Z","title":"BOP challenge 2023 on detection, segmentation and pose estimation of seen and unseen rigid objects","venue":null,"work_id":"e4cb9b47-6627-4885-aea4-b5247497d359","year":2023},"citing_paper":{"arxiv_id":"2411.19167","last_updated":"2025-04-30T13:32:06Z","snapshot_observed_at":"2026-08-14T04:48:32.710988Z","submitted_at":"2024-11-28T14:09:42Z","title":"HOT3D: Hand and Object Tracking in 3D from Egocentric Multi-View Videos","version":2},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-08-12T10:32:42.977708Z"},"links":{"citing_paper":"/paper/2411.19167"},"observation_digest":"sha256:8d64de19ea1ed52e0d787827a28d00e299134bee760002896abc734a0bee9059","observation_id":"35ae9250-064b-4e82-918d-2a664f80c128","resolution":{"observed_at":"2026-08-12T10:32:43.683235Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T10:32:43.666110Z","title":"Photorealistic image synthesis for object instance detection","venue":null,"work_id":"d35556e2-7fe0-42b8-aa27-a74a9062083e","year":2019},"citing_paper":{"arxiv_id":"2411.19167","last_updated":"2025-04-30T13:32:06Z","snapshot_observed_at":"2026-08-14T04:48:32.710988Z","submitted_at":"2024-11-28T14:09:42Z","title":"HOT3D: Hand and Object Tracking in 3D from Egocentric Multi-View Videos","version":2},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-08-12T10:32:42.981528Z"},"links":{"citing_paper":"/paper/2411.19167"},"observation_digest":"sha256:eda124fc26db4a2fd47e458fae44f89b42a8cd93e58b4388f5611ccd5306ffe9","observation_id":"75944433-5423-446b-8141-ece76bebd505","resolution":{"observed_at":"2026-08-12T10:32:43.670118Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2212.10428","last_updated":"2023-12-01T13:23:47Z","snapshot_observed_at":"2026-08-17T12:44:00.609040Z","submitted_at":"2022-12-20T17:06:32Z","title":"HouseCat6D -- A Large-Scale Multi-Modal Category Level 6D Object Perception Dataset with Household Objects in Realistic Scenarios","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2212.10428","snapshot_observed_at":"2026-08-12T10:32:42.986529Z","title":"House- Cat6D – a large-scale multi-modal category level 6D object perception dataset with household objects in realistic scenarios","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2411.19167","last_updated":"2025-04-30T13:32:06Z","snapshot_observed_at":"2026-08-14T04:48:32.710988Z","submitted_at":"2024-11-28T14:09:42Z","title":"HOT3D: Hand and Object Tracking in 3D from Egocentric Multi-View Videos","version":2},"reference_index":36,"source":"pdf_text","source_observed_at":"2026-08-12T10:32:42.986529Z"},"links":{"cited_paper":"/paper/2212.10428","citing_paper":"/paper/2411.19167"},"observation_digest":"sha256:b0835f76a31c4b25b367e629d07fab0238eecc908ade552b128026d542a27896","observation_id":"774a6201-c4bd-447c-9411-d675797e4d5e","resolution":{"observed_at":"2026-08-12T10:32:42.986529Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T10:32:43.654736Z","title":"Efficient intersection of three quadrics and applications in computer vision","venue":null,"work_id":"e243d95d-64a1-470b-ad94-9796a2c8c04e","year":2016},"citing_paper":{"arxiv_id":"2411.19167","last_updated":"2025-04-30T13:32:06Z","snapshot_observed_at":"2026-08-14T04:48:32.710988Z","submitted_at":"2024-11-28T14:09:42Z","title":"HOT3D: Hand and Object Tracking in 3D from Egocentric Multi-View Videos","version":2},"reference_index":37,"source":"pdf_text","source_observed_at":"2026-08-12T10:32:42.991134Z"},"links":{"citing_paper":"/paper/2411.19167"},"observation_digest":"sha256:33a58dba9a3daca5f5c1208bc379a2395b4f246ba67c41ffb5d51e95d2021d09","observation_id":"f76a6215-0aec-4936-9ec2-24a7c3c2e2a6","resolution":{"observed_at":"2026-08-12T10:32:43.658562Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T10:32:43.643096Z","title":"H2O: A benchmark for egocentric hand-object interaction recognition.IEEE Transactions on Multimedia, 2020","venue":null,"work_id":"2f812900-5227-462e-90dd-75f5fb30a5b6","year":2020},"citing_paper":{"arxiv_id":"2411.19167","last_updated":"2025-04-30T13:32:06Z","snapshot_observed_at":"2026-08-14T04:48:32.710988Z","submitted_at":"2024-11-28T14:09:42Z","title":"HOT3D: Hand and Object Tracking in 3D from Egocentric Multi-View Videos","version":2},"reference_index":38,"source":"pdf_text","source_observed_at":"2026-08-12T10:32:42.995199Z"},"links":{"citing_paper":"/paper/2411.19167"},"observation_digest":"sha256:d33120a1dc4c5728adf658ace3b40add9983aba4b3829afb70d3e49fceee4cdf","observation_id":"8ea1ebfe-84be-41c3-89da-5afb339f0725","resolution":{"observed_at":"2026-08-12T10:32:43.647103Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T10:32:43.631859Z","title":"HOI4D: A 4D egocentric dataset for category-level human-object interaction","venue":null,"work_id":"7d2b3faf-1617-4b0a-81db-a77e81027eaf","year":2022},"citing_paper":{"arxiv_id":"2411.19167","last_updated":"2025-04-30T13:32:06Z","snapshot_observed_at":"2026-08-14T04:48:32.710988Z","submitted_at":"2024-11-28T14:09:42Z","title":"HOT3D: Hand and Object Tracking in 3D from Egocentric Multi-View Videos","version":2},"reference_index":39,"source":"pdf_text","source_observed_at":"2026-08-12T10:32:42.998930Z"},"links":{"citing_paper":"/paper/2411.19167"},"observation_digest":"sha256:644bc6c3ccbcd2dbabc3528248a93d345148f205f3d41f0621047ee87d5b054d","observation_id":"784b34e3-6105-40e0-bf54-7139173ce5cc","resolution":{"observed_at":"2026-08-12T10:32:43.635520Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T10:32:43.620680Z","title":"The PBR guide","venue":null,"work_id":"fa200062-4c03-4099-84f9-8cbbe1a6abe1","year":2018},"citing_paper":{"arxiv_id":"2411.19167","last_updated":"2025-04-30T13:32:06Z","snapshot_observed_at":"2026-08-14T04:48:32.710988Z","submitted_at":"2024-11-28T14:09:42Z","title":"HOT3D: Hand and Object Tracking in 3D from Egocentric Multi-View Videos","version":2},"reference_index":40,"source":"pdf_text","source_observed_at":"2026-08-12T10:32:43.003165Z"},"links":{"citing_paper":"/paper/2411.19167"},"observation_digest":"sha256:f0b3d82387d006f34fcde23b7a48a4342ed0bf019d359ab6f897b7e17c5917c0","observation_id":"34fa53a8-cb97-4abc-b6dd-9c03c82afeba","resolution":{"observed_at":"2026-08-12T10:32:43.625341Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T10:32:43.610008Z","title":"Quest 3.https://www.meta.com/quest/quest- 3/, 2023","venue":null,"work_id":"146e0e83-f50f-41c8-ba66-c287d13e718a","year":2023},"citing_paper":{"arxiv_id":"2411.19167","last_updated":"2025-04-30T13:32:06Z","snapshot_observed_at":"2026-08-14T04:48:32.710988Z","submitted_at":"2024-11-28T14:09:42Z","title":"HOT3D: Hand and Object Tracking in 3D from Egocentric Multi-View Videos","version":2},"reference_index":41,"source":"pdf_text","source_observed_at":"2026-08-12T10:32:43.007473Z"},"links":{"citing_paper":"/paper/2411.19167"},"observation_digest":"sha256:31c1289a5c5e78b3d52405a99068be32ff2c89e6a967be2b4a6413987ec1711f","observation_id":"a54574bd-26b4-4c0b-afc5-f67351a049c4","resolution":{"observed_at":"2026-08-12T10:32:43.613707Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T10:32:43.599444Z","title":"NeRF: Representing scenes as neural radiance fields for view synthesis.ECCV, 2020","venue":null,"work_id":"844a4e93-dac9-43bd-8086-05ed33cdde9f","year":2020},"citing_paper":{"arxiv_id":"2411.19167","last_updated":"2025-04-30T13:32:06Z","snapshot_observed_at":"2026-08-14T04:48:32.710988Z","submitted_at":"2024-11-28T14:09:42Z","title":"HOT3D: Hand and Object Tracking in 3D from Egocentric Multi-View Videos","version":2},"reference_index":42,"source":"pdf_text","source_observed_at":"2026-08-12T10:32:43.010919Z"},"links":{"citing_paper":"/paper/2411.19167"},"observation_digest":"sha256:b80e32340c85b3bcd0c5bb23b2f5b3db5cc9a2b70c713f572a4241bce71cf055","observation_id":"4746beaa-286d-4e89-a07a-0023c10f7e34","resolution":{"observed_at":"2026-08-12T10:32:43.603448Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T10:32:43.588807Z","title":"Interhand2.6M: A dataset and baseline for 3D interacting hand pose estimation from a single RGB image","venue":null,"work_id":"a9edab8c-9552-40bb-9e67-9faa4f5a44b4","year":2020},"citing_paper":{"arxiv_id":"2411.19167","last_updated":"2025-04-30T13:32:06Z","snapshot_observed_at":"2026-08-14T04:48:32.710988Z","submitted_at":"2024-11-28T14:09:42Z","title":"HOT3D: Hand and Object Tracking in 3D from Egocentric Multi-View Videos","version":2},"reference_index":43,"source":"pdf_text","source_observed_at":"2026-08-12T10:32:43.014334Z"},"links":{"citing_paper":"/paper/2411.19167"},"observation_digest":"sha256:b7bafd598dba2a95b9333d138bd092df6a8608fed750453734452481a191eaf6","observation_id":"0d355bf3-04ff-4b2a-b45e-66bd15099db4","resolution":{"observed_at":"2026-08-12T10:32:43.592764Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T10:32:43.577587Z","title":"Real-time hand tracking under occlusion from an egocentric RGB-D sensor","venue":null,"work_id":"694519c2-43d8-468e-9058-e860be79324b","year":2017},"citing_paper":{"arxiv_id":"2411.19167","last_updated":"2025-04-30T13:32:06Z","snapshot_observed_at":"2026-08-14T04:48:32.710988Z","submitted_at":"2024-11-28T14:09:42Z","title":"HOT3D: Hand and Object Tracking in 3D from Egocentric Multi-View Videos","version":2},"reference_index":44,"source":"pdf_text","source_observed_at":"2026-08-12T10:32:43.019344Z"},"links":{"citing_paper":"/paper/2411.19167"},"observation_digest":"sha256:c5cf70d209c52ef6aa79379fcab2201d599785577419d4bc36acfee5771fc385","observation_id":"1609c816-d938-4280-a8a8-d3087a5a7a64","resolution":{"observed_at":"2026-08-12T10:32:43.581043Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T10:32:43.566934Z","title":"Visual learning and recognition of 3-D objects from appearance.IJCV, 1995","venue":null,"work_id":"1e061afd-91cb-4649-a5c1-89b3d3022c57","year":1995},"citing_paper":{"arxiv_id":"2411.19167","last_updated":"2025-04-30T13:32:06Z","snapshot_observed_at":"2026-08-14T04:48:32.710988Z","submitted_at":"2024-11-28T14:09:42Z","title":"HOT3D: Hand and Object Tracking in 3D from Egocentric Multi-View Videos","version":2},"reference_index":45,"source":"pdf_text","source_observed_at":"2026-08-12T10:32:43.022955Z"},"links":{"citing_paper":"/paper/2411.19167"},"observation_digest":"sha256:c01830836ec948da658ec61b934463bd12dccc7eb50369fa6848fefcf445a510","observation_id":"fd203094-f034-47a5-8e64-677637465e79","resolution":{"observed_at":"2026-08-12T10:32:43.570296Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T10:32:43.556585Z","title":"KinectFusion: Real-time dense surface mapping and tracking.ISMAR, 2011","venue":null,"work_id":"f1dcc2c0-76d9-42ee-b974-747bddceb3a8","year":2011},"citing_paper":{"arxiv_id":"2411.19167","last_updated":"2025-04-30T13:32:06Z","snapshot_observed_at":"2026-08-14T04:48:32.710988Z","submitted_at":"2024-11-28T14:09:42Z","title":"HOT3D: Hand and Object Tracking in 3D from Egocentric Multi-View Videos","version":2},"reference_index":46,"source":"pdf_text","source_observed_at":"2026-08-12T10:32:43.026353Z"},"links":{"citing_paper":"/paper/2411.19167"},"observation_digest":"sha256:466e7053b5c3c11cea8c22d07acab61db6555d305056b3277d8004e52392c35e","observation_id":"c47d3bf4-4b7e-478f-9ac9-586d760c6a4b","resolution":{"observed_at":"2026-08-12T10:32:43.560188Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T10:32:43.544805Z","title":"AssemblyHands: Towards egocentric activ- ity understanding via 3D hand pose estimation","venue":null,"work_id":"36dce2b3-1cd9-4786-ba86-417876638cdb","year":2023},"citing_paper":{"arxiv_id":"2411.19167","last_updated":"2025-04-30T13:32:06Z","snapshot_observed_at":"2026-08-14T04:48:32.710988Z","submitted_at":"2024-11-28T14:09:42Z","title":"HOT3D: Hand and Object Tracking in 3D from Egocentric Multi-View Videos","version":2},"reference_index":47,"source":"pdf_text","source_observed_at":"2026-08-12T10:32:43.030448Z"},"links":{"citing_paper":"/paper/2411.19167"},"observation_digest":"sha256:2430289d62b07b68195fb31d2a2335ee2c95bbe5936dd0b1af81b8ecc155f5d2","observation_id":"a74d4d1b-cc54-42a3-bb0f-b8abb3b19779","resolution":{"observed_at":"2026-08-12T10:32:43.548474Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T10:32:43.533587Z","title":"HANDS18: Methods, techniques and applications for hand observation","venue":null,"work_id":"5062a08e-dda4-43c2-a899-7740c7051148","year":2018},"citing_paper":{"arxiv_id":"2411.19167","last_updated":"2025-04-30T13:32:06Z","snapshot_observed_at":"2026-08-14T04:48:32.710988Z","submitted_at":"2024-11-28T14:09:42Z","title":"HOT3D: Hand and Object Tracking in 3D from Egocentric Multi-View Videos","version":2},"reference_index":48,"source":"pdf_text","source_observed_at":"2026-08-12T10:32:43.033811Z"},"links":{"citing_paper":"/paper/2411.19167"},"observation_digest":"sha256:ce5b7c8ab0fff3229d55f9da781c74e241f11c907ab7575816a543fc2b86f995","observation_id":"4ef65c72-98a9-42f3-a5ca-77a8a7fd49f9","resolution":{"observed_at":"2026-08-12T10:32:43.537744Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T10:32:43.522092Z","title":"DINOv2: Learning robust visual features without supervision.TMLR, 2024","venue":null,"work_id":"e7540e89-d444-4014-bdc7-56e8d807cc3e","year":2024},"citing_paper":{"arxiv_id":"2411.19167","last_updated":"2025-04-30T13:32:06Z","snapshot_observed_at":"2026-08-14T04:48:32.710988Z","submitted_at":"2024-11-28T14:09:42Z","title":"HOT3D: Hand and Object Tracking in 3D from Egocentric Multi-View Videos","version":2},"reference_index":49,"source":"pdf_text","source_observed_at":"2026-08-12T10:32:43.037978Z"},"links":{"citing_paper":"/paper/2411.19167"},"observation_digest":"sha256:366a31f0b391227018afff7bc26dd4043eaf88906625a04e7b61d4d15edaa995","observation_id":"b90ff26e-0226-4f26-b713-d9f1e7b3aab1","resolution":{"observed_at":"2026-08-12T10:32:43.526145Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T10:32:43.510930Z","title":"FoundPose: Unseen ob- ject pose estimation with foundation features.ECCV, 2024","venue":null,"work_id":"014847a8-296e-4bbb-869c-833f9ca5ffcc","year":2024},"citing_paper":{"arxiv_id":"2411.19167","last_updated":"2025-04-30T13:32:06Z","snapshot_observed_at":"2026-08-14T04:48:32.710988Z","submitted_at":"2024-11-28T14:09:42Z","title":"HOT3D: Hand and Object Tracking in 3D from Egocentric Multi-View Videos","version":2},"reference_index":50,"source":"pdf_text","source_observed_at":"2026-08-12T10:32:43.041919Z"},"links":{"citing_paper":"/paper/2411.19167"},"observation_digest":"sha256:ffb247fd4231e62ed75be55e9b702efdecd9a9b9c1b01b3fa3e7f1d35f53fd20","observation_id":"17eca29f-d873-4f04-91f7-09a8bf1383ed","resolution":{"observed_at":"2026-08-12T10:32:43.514585Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2404.05072","last_updated":"2025-01-21T21:33:06Z","snapshot_observed_at":"2026-08-16T14:02:56.511334Z","submitted_at":"2024-04-07T21:00:14Z","title":"Spatial Cognition from Egocentric Video: Out of Sight, Not Out of Mind","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2404.05072","snapshot_observed_at":"2026-08-12T10:32:43.045666Z","title":"Spatial cognition from egocentric video: Out of sight, not out of mind.arXiv preprint arXiv:2404.05072, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2411.19167","last_updated":"2025-04-30T13:32:06Z","snapshot_observed_at":"2026-08-14T04:48:32.710988Z","submitted_at":"2024-11-28T14:09:42Z","title":"HOT3D: Hand and Object Tracking in 3D from Egocentric Multi-View Videos","version":2},"reference_index":51,"source":"pdf_text","source_observed_at":"2026-08-12T10:32:43.045666Z"},"links":{"cited_paper":"/paper/2404.05072","citing_paper":"/paper/2411.19167"},"observation_digest":"sha256:e7e7af599b7aa57548da1a0bea2f42faae006a504d43d0b48987bb931135e5a4","observation_id":"00d80fd2-3722-4458-b4a8-fb4707dd0428","resolution":{"observed_at":"2026-08-12T10:32:43.045666Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T10:32:43.497967Z","title":"Enigma-51: Towards a fine-grained understanding of human-object interactions in industrial scenarios.IEEE Winter Conference on Application of Computer V ision (WACV), 2024","venue":null,"work_id":"10f5b96d-d947-49fb-af49-4cbb3afbd935","year":2024},"citing_paper":{"arxiv_id":"2411.19167","last_updated":"2025-04-30T13:32:06Z","snapshot_observed_at":"2026-08-14T04:48:32.710988Z","submitted_at":"2024-11-28T14:09:42Z","title":"HOT3D: Hand and Object Tracking in 3D from Egocentric Multi-View Videos","version":2},"reference_index":52,"source":"pdf_text","source_observed_at":"2026-08-12T10:32:43.051286Z"},"links":{"citing_paper":"/paper/2411.19167"},"observation_digest":"sha256:f6c52930fc7d9c9c3a3c5890eecdfb1ffe019805f06291828cb317e6de7cc427","observation_id":"3c1d04d5-0266-4c43-82f0-bbefd72a533b","resolution":{"observed_at":"2026-08-12T10:32:43.503223Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T10:32:43.486796Z","title":"EgoBlur: Responsible innovation in Aria, 2023","venue":null,"work_id":"03b1546c-e77f-46d0-85c2-e79b67440523","year":2023},"citing_paper":{"arxiv_id":"2411.19167","last_updated":"2025-04-30T13:32:06Z","snapshot_observed_at":"2026-08-14T04:48:32.710988Z","submitted_at":"2024-11-28T14:09:42Z","title":"HOT3D: Hand and Object Tracking in 3D from Egocentric Multi-View Videos","version":2},"reference_index":53,"source":"pdf_text","source_observed_at":"2026-08-12T10:32:43.055209Z"},"links":{"citing_paper":"/paper/2411.19167"},"observation_digest":"sha256:bef123693a9b35c67c50b175e02e7e84479889bca174951cd5dc3c4e6fc61fc0","observation_id":"da746ace-1ea0-4514-b8e1-fcb4c50e7254","resolution":{"observed_at":"2026-08-12T10:32:43.490317Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T10:32:43.474552Z","title":"Visual tracking of high DoF articulated structures: an application to human hand tracking","venue":null,"work_id":"694abaf5-9cbd-417a-bc19-fcbed676b1ee","year":1994},"citing_paper":{"arxiv_id":"2411.19167","last_updated":"2025-04-30T13:32:06Z","snapshot_observed_at":"2026-08-14T04:48:32.710988Z","submitted_at":"2024-11-28T14:09:42Z","title":"HOT3D: Hand and Object Tracking in 3D from Egocentric Multi-View Videos","version":2},"reference_index":54,"source":"pdf_text","source_observed_at":"2026-08-12T10:32:43.058825Z"},"links":{"citing_paper":"/paper/2411.19167"},"observation_digest":"sha256:61e1dbc91d02d2ca9bf3bcb4900de6ed2f65a0e8d9f946ad98c327ce17bf78a8","observation_id":"6698a25b-f517-4830-a658-d1ca93ca674a","resolution":{"observed_at":"2026-08-12T10:32:43.478564Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T10:32:43.463859Z","title":"Machine perception of three-dimensional solids","venue":null,"work_id":"de454b5c-3fb1-404d-9364-63b81c844b83","year":1963},"citing_paper":{"arxiv_id":"2411.19167","last_updated":"2025-04-30T13:32:06Z","snapshot_observed_at":"2026-08-14T04:48:32.710988Z","submitted_at":"2024-11-28T14:09:42Z","title":"HOT3D: Hand and Object Tracking in 3D from Egocentric Multi-View Videos","version":2},"reference_index":55,"source":"pdf_text","source_observed_at":"2026-08-12T10:32:43.063044Z"},"links":{"citing_paper":"/paper/2411.19167"},"observation_digest":"sha256:2a7ddc984c3c59f6e946868ee15c49c558ec319c9ba892ea2d17f892696a42a0","observation_id":"3b9cbce9-c1ad-4c4a-ba2e-0e6033c7e956","resolution":{"observed_at":"2026-08-12T10:32:43.467891Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T10:32:43.451936Z","title":"Embodied hands: Modeling and capturing hands and bodies together.TOG,","venue":null,"work_id":"62cd4b6e-d44b-4ba2-918e-638756f3a28b","year":null},"citing_paper":{"arxiv_id":"2411.19167","last_updated":"2025-04-30T13:32:06Z","snapshot_observed_at":"2026-08-14T04:48:32.710988Z","submitted_at":"2024-11-28T14:09:42Z","title":"HOT3D: Hand and Object Tracking in 3D from Egocentric Multi-View Videos","version":2},"reference_index":56,"source":"pdf_text","source_observed_at":"2026-08-12T10:32:43.067316Z"},"links":{"citing_paper":"/paper/2411.19167"},"observation_digest":"sha256:bae99877e44d0de66745759ca8f8a1e87f3bfcf7057a202ba7394b24957ea900","observation_id":"d23fd206-54a7-4ece-9056-017e87d70672","resolution":{"observed_at":"2026-08-12T10:32:43.456083Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T10:32:43.440256Z","title":"Imagenet large scale visual recognition challenge.IJCV, 2015","venue":null,"work_id":"f64db503-31bf-4b2d-b810-bb9f083eac51","year":2015},"citing_paper":{"arxiv_id":"2411.19167","last_updated":"2025-04-30T13:32:06Z","snapshot_observed_at":"2026-08-14T04:48:32.710988Z","submitted_at":"2024-11-28T14:09:42Z","title":"HOT3D: Hand and Object Tracking in 3D from Egocentric Multi-View Videos","version":2},"reference_index":57,"source":"pdf_text","source_observed_at":"2026-08-12T10:32:43.070799Z"},"links":{"citing_paper":"/paper/2411.19167"},"observation_digest":"sha256:75ed32751862d119c7fc2a5fa8a61e1ed68dce24c4188943c86acca55007534a","observation_id":"1aecce48-6fdf-4dbb-8b53-e29075df210c","resolution":{"observed_at":"2026-08-12T10:32:43.444579Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T10:32:43.428325Z","title":"A taxonomy and evaluation of dense two-frame stereo correspondence algorithms","venue":null,"work_id":"a6d0148d-85ea-4c7e-81a8-133b7a72fefa","year":2002},"citing_paper":{"arxiv_id":"2411.19167","last_updated":"2025-04-30T13:32:06Z","snapshot_observed_at":"2026-08-14T04:48:32.710988Z","submitted_at":"2024-11-28T14:09:42Z","title":"HOT3D: Hand and Object Tracking in 3D from Egocentric Multi-View Videos","version":2},"reference_index":58,"source":"pdf_text","source_observed_at":"2026-08-12T10:32:43.075953Z"},"links":{"citing_paper":"/paper/2411.19167"},"observation_digest":"sha256:9dea4dc394e0945fc3447ff2d6f3d0d00d56afb54c3492c65b3cca9021075421","observation_id":"40be9bab-c0ef-450b-99bf-a73566d49dac","resolution":{"observed_at":"2026-08-12T10:32:43.432479Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T10:32:43.416970Z","title":"Structure-from- motion revisited","venue":null,"work_id":"af93c9be-9497-4218-b0c0-7caf446aa7ec","year":2016},"citing_paper":{"arxiv_id":"2411.19167","last_updated":"2025-04-30T13:32:06Z","snapshot_observed_at":"2026-08-14T04:48:32.710988Z","submitted_at":"2024-11-28T14:09:42Z","title":"HOT3D: Hand and Object Tracking in 3D from Egocentric Multi-View Videos","version":2},"reference_index":59,"source":"pdf_text","source_observed_at":"2026-08-12T10:32:43.079301Z"},"links":{"citing_paper":"/paper/2411.19167"},"observation_digest":"sha256:748dfca298249f0feb12f77377d1455fec14be9837f076c74538e86504cccba7","observation_id":"2327b2fd-c5e7-4e1f-bdda-31340c349713","resolution":{"observed_at":"2026-08-12T10:32:43.420736Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T10:32:43.405157Z","title":"Understanding human hands in contact at internet scale","venue":null,"work_id":"b1a36aa9-c968-4537-a1e9-5f358cb2d505","year":null},"citing_paper":{"arxiv_id":"2411.19167","last_updated":"2025-04-30T13:32:06Z","snapshot_observed_at":"2026-08-14T04:48:32.710988Z","submitted_at":"2024-11-28T14:09:42Z","title":"HOT3D: Hand and Object Tracking in 3D from Egocentric Multi-View Videos","version":2},"reference_index":60,"source":"pdf_text","source_observed_at":"2026-08-12T10:32:43.083352Z"},"links":{"citing_paper":"/paper/2411.19167"},"observation_digest":"sha256:e617df9282cd29fde48ff357c440749fa69c13043bc496187961e934a84de4f6","observation_id":"cbf328aa-1d3b-44b6-9f7e-a11bffa58df2","resolution":{"observed_at":"2026-08-12T10:32:43.409589Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T10:32:43.392447Z","title":"Real-time joint tracking of a hand manipulating an object from RGB-D input","venue":null,"work_id":"b62afcb0-ba47-4d97-b7f7-f1a4793c4c3b","year":null},"citing_paper":{"arxiv_id":"2411.19167","last_updated":"2025-04-30T13:32:06Z","snapshot_observed_at":"2026-08-14T04:48:32.710988Z","submitted_at":"2024-11-28T14:09:42Z","title":"HOT3D: Hand and Object Tracking in 3D from Egocentric Multi-View Videos","version":2},"reference_index":61,"source":"pdf_text","source_observed_at":"2026-08-12T10:32:43.087521Z"},"links":{"citing_paper":"/paper/2411.19167"},"observation_digest":"sha256:335906a367f61ccc5798e6a2e59b43338e6f36cc412cb7b6c926ac4206cb9c31","observation_id":"e98e914f-c644-4988-98c1-6bd429e2f6e8","resolution":{"observed_at":"2026-08-12T10:32:43.396956Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T10:32:43.379987Z","title":"OnePose: One-shot object pose estimation without cad models","venue":null,"work_id":"7640391e-5824-4502-abe4-7bb0417fc433","year":2022},"citing_paper":{"arxiv_id":"2411.19167","last_updated":"2025-04-30T13:32:06Z","snapshot_observed_at":"2026-08-14T04:48:32.710988Z","submitted_at":"2024-11-28T14:09:42Z","title":"HOT3D: Hand and Object Tracking in 3D from Egocentric Multi-View Videos","version":2},"reference_index":62,"source":"pdf_text","source_observed_at":"2026-08-12T10:32:43.091115Z"},"links":{"citing_paper":"/paper/2411.19167"},"observation_digest":"sha256:ffec3658a257c57e8c11e559bab471d2c80974b6065bb50840d1ff91b575c3cb","observation_id":"627764c4-31df-4fca-b9e5-26afa4e25227","resolution":{"observed_at":"2026-08-12T10:32:43.384456Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T10:32:43.368587Z","title":"Cascaded hand pose regression","venue":null,"work_id":"ff98a2f2-335b-40ec-9252-78468c88b10b","year":2015},"citing_paper":{"arxiv_id":"2411.19167","last_updated":"2025-04-30T13:32:06Z","snapshot_observed_at":"2026-08-14T04:48:32.710988Z","submitted_at":"2024-11-28T14:09:42Z","title":"HOT3D: Hand and Object Tracking in 3D from Egocentric Multi-View Videos","version":2},"reference_index":63,"source":"pdf_text","source_observed_at":"2026-08-12T10:32:43.094980Z"},"links":{"citing_paper":"/paper/2411.19167"},"observation_digest":"sha256:c8c92b7e62a3004dc11377e0838dc14e9c848405f96871fa7ce62d89c6bc5863","observation_id":"f62a30a4-806c-413b-8569-61cc6c652ea4","resolution":{"observed_at":"2026-08-12T10:32:43.372307Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T10:32:43.355121Z","title":"BOP challenge 2022 on detection, segmentation and pose estimation of specific rigid objects.CVPRW, 2023","venue":null,"work_id":"74422f40-9b0a-49dc-b9bf-6452a4f7452c","year":2022},"citing_paper":{"arxiv_id":"2411.19167","last_updated":"2025-04-30T13:32:06Z","snapshot_observed_at":"2026-08-14T04:48:32.710988Z","submitted_at":"2024-11-28T14:09:42Z","title":"HOT3D: Hand and Object Tracking in 3D from Egocentric Multi-View Videos","version":2},"reference_index":64,"source":"pdf_text","source_observed_at":"2026-08-12T10:32:43.099941Z"},"links":{"citing_paper":"/paper/2411.19167"},"observation_digest":"sha256:dbc3e58c5d99157de4c10e67c35f4b5205abae8e78907253db45bb5a8cbcccba","observation_id":"2140a111-1dd7-45e3-b6d0-b45ce2a16e0b","resolution":{"observed_at":"2026-08-12T10:32:43.359333Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T10:32:43.342287Z","title":"Latent regression forest: Structured estimation of 3D articulated hand posture","venue":null,"work_id":"8759d8ea-207b-44f3-812a-4f01be9a3bcc","year":2014},"citing_paper":{"arxiv_id":"2411.19167","last_updated":"2025-04-30T13:32:06Z","snapshot_observed_at":"2026-08-14T04:48:32.710988Z","submitted_at":"2024-11-28T14:09:42Z","title":"HOT3D: Hand and Object Tracking in 3D from Egocentric Multi-View Videos","version":2},"reference_index":65,"source":"pdf_text","source_observed_at":"2026-08-12T10:32:43.103732Z"},"links":{"citing_paper":"/paper/2411.19167"},"observation_digest":"sha256:1c8b7cbf36649cf09c5d2ebc04e10ad21583dac750353056fd3de8c9ba920f28","observation_id":"bfa9701e-75a6-4d6b-aece-aa9f1db33ca9","resolution":{"observed_at":"2026-08-12T10:32:43.346496Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T10:32:43.329466Z","title":"Real-time continuous pose recovery of human hands using convolutional networks.T oG, 2014","venue":null,"work_id":"ec4a274a-a5c7-435e-9c92-42ae605abce7","year":2014},"citing_paper":{"arxiv_id":"2411.19167","last_updated":"2025-04-30T13:32:06Z","snapshot_observed_at":"2026-08-14T04:48:32.710988Z","submitted_at":"2024-11-28T14:09:42Z","title":"HOT3D: Hand and Object Tracking in 3D from Egocentric Multi-View Videos","version":2},"reference_index":66,"source":"pdf_text","source_observed_at":"2026-08-12T10:32:43.107316Z"},"links":{"citing_paper":"/paper/2411.19167"},"observation_digest":"sha256:01c77ee1a6a85490482959bd1273d370e11eef4d7f519600364ba1d7b342a81b","observation_id":"d26dbc8f-7389-46e9-914d-ea7abeb33086","resolution":{"observed_at":"2026-08-12T10:32:43.333840Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T10:32:43.315569Z","title":"Capturing hands in action using discriminative salient points and physics simulation.IJCV, 2016","venue":null,"work_id":"9fe3be53-9718-4699-8861-5217cc4555d9","year":2016},"citing_paper":{"arxiv_id":"2411.19167","last_updated":"2025-04-30T13:32:06Z","snapshot_observed_at":"2026-08-14T04:48:32.710988Z","submitted_at":"2024-11-28T14:09:42Z","title":"HOT3D: Hand and Object Tracking in 3D from Egocentric Multi-View Videos","version":2},"reference_index":67,"source":"pdf_text","source_observed_at":"2026-08-12T10:32:43.110887Z"},"links":{"citing_paper":"/paper/2411.19167"},"observation_digest":"sha256:590ca0c0ffe26c21b3423304f816b0259b6312872056d77200f0aed6fec89269","observation_id":"5ae0f560-0052-469e-b7a9-d6c72da02267","resolution":{"observed_at":"2026-08-12T10:32:43.320670Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T10:32:43.302796Z","title":"Hololens 2 research mode as a tool for computer vision research.arXiv, 2020","venue":null,"work_id":"03ad2e27-b9be-4a7d-9d14-8a28f5108eeb","year":2020},"citing_paper":{"arxiv_id":"2411.19167","last_updated":"2025-04-30T13:32:06Z","snapshot_observed_at":"2026-08-14T04:48:32.710988Z","submitted_at":"2024-11-28T14:09:42Z","title":"HOT3D: Hand and Object Tracking in 3D from Egocentric Multi-View Videos","version":2},"reference_index":68,"source":"pdf_text","source_observed_at":"2026-08-12T10:32:43.115379Z"},"links":{"citing_paper":"/paper/2411.19167"},"observation_digest":"sha256:88bbfd1b8d6bc3e3977c94d736232395813b42182b1fdd254b68831ec896e3d8","observation_id":"9a7ce734-a509-4a6e-a739-859238c2b2e2","resolution":{"observed_at":"2026-08-12T10:32:43.307050Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T10:32:43.289629Z","title":"Ho-cap: A capture system and dataset for 3d recon- struction and pose tracking of hand-object interaction, 2024","venue":null,"work_id":"82fad624-82f3-456e-89f7-516b66ce0e49","year":2024},"citing_paper":{"arxiv_id":"2411.19167","last_updated":"2025-04-30T13:32:06Z","snapshot_observed_at":"2026-08-14T04:48:32.710988Z","submitted_at":"2024-11-28T14:09:42Z","title":"HOT3D: Hand and Object Tracking in 3D from Egocentric Multi-View Videos","version":2},"reference_index":69,"source":"pdf_text","source_observed_at":"2026-08-12T10:32:43.118924Z"},"links":{"citing_paper":"/paper/2411.19167"},"observation_digest":"sha256:7517abf04224818c104f85c1d8116cfba6188c91b16b529d2b1060525da45667","observation_id":"9bcd9527-7f28-45ba-9f85-5f3c006f240c","resolution":{"observed_at":"2026-08-12T10:32:43.294093Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T10:32:43.277422Z","title":"Phocal: A multi-modal dataset for category-level object pose estimation with photometrically challenging objects","venue":null,"work_id":"a34f3c00-370c-4983-aa08-1bea3a56e061","year":2022},"citing_paper":{"arxiv_id":"2411.19167","last_updated":"2025-04-30T13:32:06Z","snapshot_observed_at":"2026-08-14T04:48:32.710988Z","submitted_at":"2024-11-28T14:09:42Z","title":"HOT3D: Hand and Object Tracking in 3D from Egocentric Multi-View Videos","version":2},"reference_index":70,"source":"pdf_text","source_observed_at":"2026-08-12T10:32:43.122628Z"},"links":{"citing_paper":"/paper/2411.19167"},"observation_digest":"sha256:81866351bc1ba85c74d35782bc5c838907a667f67d403dd4c5f3db304bd88d91","observation_id":"c46720e3-af4a-4daa-bd35-44c5162ac848","resolution":{"observed_at":"2026-08-12T10:32:43.281326Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T10:32:43.265403Z","title":"PoseCNN: A convolutional neural network for 6D object pose estimation in cluttered scenes.RSS, 2018","venue":null,"work_id":"909fd347-4938-46aa-87ca-b297025827d1","year":2018},"citing_paper":{"arxiv_id":"2411.19167","last_updated":"2025-04-30T13:32:06Z","snapshot_observed_at":"2026-08-14T04:48:32.710988Z","submitted_at":"2024-11-28T14:09:42Z","title":"HOT3D: Hand and Object Tracking in 3D from Egocentric Multi-View Videos","version":2},"reference_index":71,"source":"pdf_text","source_observed_at":"2026-08-12T10:32:43.126913Z"},"links":{"citing_paper":"/paper/2411.19167"},"observation_digest":"sha256:40abf755fbe56164d69cf304017b34f81e384c090bb60db12b7ef60e5dab6b5b","observation_id":"7551dbcd-47a2-4a39-9cda-0b8731173db9","resolution":{"observed_at":"2026-08-12T10:32:43.269133Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2406.09414","last_updated":"2024-10-20T11:24:09Z","snapshot_observed_at":"2026-07-06T18:30:32.982860Z","submitted_at":"2024-06-13T17:59:56Z","title":"Depth Anything V2","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2406.09414","snapshot_observed_at":"2026-08-12T10:32:43.130695Z","title":"Depth anything v2","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2411.19167","last_updated":"2025-04-30T13:32:06Z","snapshot_observed_at":"2026-08-14T04:48:32.710988Z","submitted_at":"2024-11-28T14:09:42Z","title":"HOT3D: Hand and Object Tracking in 3D from Egocentric Multi-View Videos","version":2},"reference_index":72,"source":"pdf_text","source_observed_at":"2026-08-12T10:32:43.130695Z"},"links":{"cited_paper":"/paper/2406.09414","citing_paper":"/paper/2411.19167"},"observation_digest":"sha256:c7e2fb2f24401760626c18d0df19317ff48032b43e1eb4630aa77eadf6890e1b","observation_id":"f5b1504f-4e2d-4ba5-b2e3-cfa46d56c0fd","resolution":{"observed_at":"2026-08-12T10:32:43.130695Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1707.02237","last_updated":"2017-07-07T15:46:58Z","snapshot_observed_at":"2026-08-14T20:49:01.565742Z","submitted_at":"2017-07-07T15:46:58Z","title":"The 2017 Hands in the Million Challenge on 3D Hand Pose Estimation","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1707.02237","snapshot_observed_at":"2026-08-12T10:32:43.135243Z","title":"The 2017 HANDS in the million challenge on 3D hand pose estimation","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2411.19167","last_updated":"2025-04-30T13:32:06Z","snapshot_observed_at":"2026-08-14T04:48:32.710988Z","submitted_at":"2024-11-28T14:09:42Z","title":"HOT3D: Hand and Object Tracking in 3D from Egocentric Multi-View Videos","version":2},"reference_index":73,"source":"pdf_text","source_observed_at":"2026-08-12T10:32:43.135243Z"},"links":{"cited_paper":"/paper/1707.02237","citing_paper":"/paper/2411.19167"},"observation_digest":"sha256:9668cf9031a3cb5421437966e9018ab0e45628a99dd5eb5546ff6f1f8bbd6ac3","observation_id":"36bb88bc-9e58-408f-954c-d91beeae44fe","resolution":{"observed_at":"2026-08-12T10:32:43.135243Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1610.07214","last_updated":"2016-10-23T18:39:53Z","snapshot_observed_at":"2026-08-14T21:33:57.873118Z","submitted_at":"2016-10-23T18:39:53Z","title":"3D Hand Pose Tracking and Estimation Using Stereo Matching","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1610.07214","snapshot_observed_at":"2026-08-12T10:32:43.139251Z","title":"3D hand pose tracking and es- timation using stereo matching.arXiv preprint arXiv:1610.07214,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2411.19167","last_updated":"2025-04-30T13:32:06Z","snapshot_observed_at":"2026-08-14T04:48:32.710988Z","submitted_at":"2024-11-28T14:09:42Z","title":"HOT3D: Hand and Object Tracking in 3D from Egocentric Multi-View Videos","version":2},"reference_index":74,"source":"pdf_text","source_observed_at":"2026-08-12T10:32:43.139251Z"},"links":{"cited_paper":"/paper/1610.07214","citing_paper":"/paper/2411.19167"},"observation_digest":"sha256:6d57bcf0cdaba88b77d79eef4e7ba3ff2a628ddafaa13502620182ef4150f022","observation_id":"0b72ea5f-b297-45bd-b8d7-e7f588695c6f","resolution":{"observed_at":"2026-08-12T10:32:43.139251Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T10:32:43.252363Z","title":"Fine-grained egocentric hand-object segmentation: Dataset, model, and applications","venue":null,"work_id":"1db6a564-d412-4038-a892-84007d5f30d1","year":2022},"citing_paper":{"arxiv_id":"2411.19167","last_updated":"2025-04-30T13:32:06Z","snapshot_observed_at":"2026-08-14T04:48:32.710988Z","submitted_at":"2024-11-28T14:09:42Z","title":"HOT3D: Hand and Object Tracking in 3D from Egocentric Multi-View Videos","version":2},"reference_index":75,"source":"pdf_text","source_observed_at":"2026-08-12T10:32:43.143405Z"},"links":{"citing_paper":"/paper/2411.19167"},"observation_digest":"sha256:bc42130143d22b2e0bb4ecc93c7c95e53cdc7a507e588fe21440f77c9a692e3b","observation_id":"0a42b3b8-df11-4c4a-8c49-78b111bd96dd","resolution":{"observed_at":"2026-08-12T10:32:43.256517Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T10:32:43.237788Z","title":"FreiHAND: A dataset for markerless capture of hand pose and shape from single RGB images","venue":null,"work_id":"4ab4207d-dce9-49d7-9cdb-d73996d00263","year":2019},"citing_paper":{"arxiv_id":"2411.19167","last_updated":"2025-04-30T13:32:06Z","snapshot_observed_at":"2026-08-14T04:48:32.710988Z","submitted_at":"2024-11-28T14:09:42Z","title":"HOT3D: Hand and Object Tracking in 3D from Egocentric Multi-View Videos","version":2},"reference_index":76,"source":"pdf_text","source_observed_at":"2026-08-12T10:32:43.146958Z"},"links":{"citing_paper":"/paper/2411.19167"},"observation_digest":"sha256:96f00830f42e52f9385f0aebaae88b9622dbd2e699e5d761f6d4e68744958176","observation_id":"1a08dbff-0120-450a-bece-97f8fa3d6b12","resolution":{"observed_at":"2026-08-12T10:32:43.243806Z","resolver_source":"raw_fallback","status":"malformed_identifier"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}}],"paper":{"arxiv_id":"2411.19167","last_updated":"2025-04-30T13:32:06Z","latest_version":2,"primary_category":"cs.CV","snapshot_observed_at":"2026-08-14T04:48:32.710988Z","submitted_at":"2024-11-28T14:09:42Z","title":"HOT3D: Hand and Object Tracking in 3D from Egocentric Multi-View Videos"},"reference_resolution":{"displayed":76,"state_counts":{"malformed_identifier":1,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":7,"verified_exact":0,"verified_fuzzy":68},"total_outbound_references":76},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"thesis":"As of 23 August 2026, this Paper Citation Record lists 76 of 76 outbound references and 9 inbound Pith citation observations for arXiv:2411.19167."}