{"as_of":"2026-08-13T21:02:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:fd00eaacb8be22350fa026544a2714793e7339fbde069d91ea0945e40ae6ce72","coverage":[{"denominator":181,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":100,"source":"paper_references, paper_reference_links","source_observed_at":"2026-06-28T10:14:42.067337Z","state":"measured"},{"denominator":100,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":100,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-13T06:32:02.005865+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2606.04291/citation-record","integrity":"/paper/2606.04291/integrity","json":"/paper/2606.04291/citation-record.json","paper":"/paper/2606.04291"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-28T10:14:42.067337Z","title":"Pointnetlk: Robust & efficient point cloud registration using pointnet","venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2606.04291","last_updated":"2026-06-02T23:41:52Z","snapshot_observed_at":"2026-08-12T18:56:09.302526Z","submitted_at":"2026-06-02T23:41:52Z","title":"A Cookbook of 3D Vision: Data, Learning Paradigms, and Application","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-06-28T10:14:42.067337Z"},"links":{"citing_paper":"/paper/2606.04291"},"observation_digest":"sha256:fd7a7bf020653f1cb0a4f2a12582cd04405b6de7066b55203d29cb148a128807","observation_id":"301447fd-672a-4f5d-b758-8814394cec33","resolution":{"observed_at":"2026-06-28T10:14:42.067337Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-28T10:14:42.067337Z","title":"Navigation world models, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2606.04291","last_updated":"2026-06-02T23:41:52Z","snapshot_observed_at":"2026-08-12T18:56:09.302526Z","submitted_at":"2026-06-02T23:41:52Z","title":"A Cookbook of 3D Vision: Data, Learning Paradigms, and Application","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-06-28T10:14:42.067337Z"},"links":{"citing_paper":"/paper/2606.04291"},"observation_digest":"sha256:c31f810c46a6695d7103b5289f7c1608f607cf02dcbb02aab88c496366f22c15","observation_id":"a48d9d57-27df-4e19-8bfb-4c97f3537d07","resolution":{"observed_at":"2026-06-28T10:14:42.067337Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-28T10:14:42.067337Z","title":"A dataset for semantic scene understanding of lidar sequences","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2606.04291","last_updated":"2026-06-02T23:41:52Z","snapshot_observed_at":"2026-08-12T18:56:09.302526Z","submitted_at":"2026-06-02T23:41:52Z","title":"A Cookbook of 3D Vision: Data, Learning Paradigms, and Application","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-06-28T10:14:42.067337Z"},"links":{"citing_paper":"/paper/2606.04291"},"observation_digest":"sha256:9be00b9979e5823d03c1771163edc123fa6705e4d5a3302baf0931a3fdfbd712","observation_id":"06d07f4b-8486-4ab0-a604-6f50d48ba53c","resolution":{"observed_at":"2026-06-28T10:14:42.067337Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-28T10:14:42.067337Z","title":"Virtual kitti 2, 2020","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2606.04291","last_updated":"2026-06-02T23:41:52Z","snapshot_observed_at":"2026-08-12T18:56:09.302526Z","submitted_at":"2026-06-02T23:41:52Z","title":"A Cookbook of 3D Vision: Data, Learning Paradigms, and Application","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-06-28T10:14:42.067337Z"},"links":{"citing_paper":"/paper/2606.04291"},"observation_digest":"sha256:36828c91471ea26fd19ea946ef507984814e8336b9f6e9eeac09c77d501da9ae","observation_id":"08e9b75d-c400-4e15-8d22-4f2b8a0f3482","resolution":{"observed_at":"2026-06-28T10:14:42.067337Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-28T10:14:42.067337Z","title":"Monoscene: Monocular 3d semantic scene completion, 2022","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2606.04291","last_updated":"2026-06-02T23:41:52Z","snapshot_observed_at":"2026-08-12T18:56:09.302526Z","submitted_at":"2026-06-02T23:41:52Z","title":"A Cookbook of 3D Vision: Data, Learning Paradigms, and Application","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-06-28T10:14:42.067337Z"},"links":{"citing_paper":"/paper/2606.04291"},"observation_digest":"sha256:3764c177caca64b7e9a1c503a418539382738daccb7cc059828265711a923243","observation_id":"baba8ceb-5759-4988-b70b-59a00e9fc93c","resolution":{"observed_at":"2026-06-28T10:14:42.067337Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-28T10:14:42.067337Z","title":"Matterport3d: Learning from rgb-d data in indoor environments, 2017","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2606.04291","last_updated":"2026-06-02T23:41:52Z","snapshot_observed_at":"2026-08-12T18:56:09.302526Z","submitted_at":"2026-06-02T23:41:52Z","title":"A Cookbook of 3D Vision: Data, Learning Paradigms, and Application","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-06-28T10:14:42.067337Z"},"links":{"citing_paper":"/paper/2606.04291"},"observation_digest":"sha256:de3cf169ff8ed9dbfe19ce5b1c7a450394ceec65540dfe0b7118be0421b726e0","observation_id":"ec4cedd5-9276-4b50-915a-428ea23fc952","resolution":{"observed_at":"2026-06-28T10:14:42.067337Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-28T10:14:42.067337Z","title":"Chang, Thomas Funkhouser, Leonidas Guibas, Pat Hanrahan, Qixing Huang, Zimo Li, Silvio Savarese, Manolis Savva, Shuran Song, Hao Su, Jianxiong Xiao, Li Yi, and Fisher Yu","venue":null,"work_id":null,"year":2015},"citing_paper":{"arxiv_id":"2606.04291","last_updated":"2026-06-02T23:41:52Z","snapshot_observed_at":"2026-08-12T18:56:09.302526Z","submitted_at":"2026-06-02T23:41:52Z","title":"A Cookbook of 3D Vision: Data, Learning Paradigms, and Application","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-06-28T10:14:42.067337Z"},"links":{"citing_paper":"/paper/2606.04291"},"observation_digest":"sha256:c58c56b7e6fe186ef0ce2c9cedc91eddec786ee8dc32290fd497fdeac561c9a7","observation_id":"8d75581e-1b46-47ce-85dc-30ee8985ad44","resolution":{"observed_at":"2026-06-28T10:14:42.067337Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-28T10:14:42.067337Z","title":"Tensorf: Tensorial radiance fields","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2606.04291","last_updated":"2026-06-02T23:41:52Z","snapshot_observed_at":"2026-08-12T18:56:09.302526Z","submitted_at":"2026-06-02T23:41:52Z","title":"A Cookbook of 3D Vision: Data, Learning Paradigms, and Application","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-06-28T10:14:42.067337Z"},"links":{"citing_paper":"/paper/2606.04291"},"observation_digest":"sha256:0e6a3f5f698d4a6ff892560d4dde9a8e9fc66c9c2b502eb37a201ed7d75e7456","observation_id":"1d647b38-4c47-49bc-8ec0-0996e7631115","resolution":{"observed_at":"2026-06-28T10:14:42.067337Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-28T10:14:42.067337Z","title":"A survey on 3d gaussian splatting, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2606.04291","last_updated":"2026-06-02T23:41:52Z","snapshot_observed_at":"2026-08-12T18:56:09.302526Z","submitted_at":"2026-06-02T23:41:52Z","title":"A Cookbook of 3D Vision: Data, Learning Paradigms, and Application","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-06-28T10:14:42.067337Z"},"links":{"citing_paper":"/paper/2606.04291"},"observation_digest":"sha256:4934cd0e5d05beb1652bdbf92936f87c30e962a53bd30bf4bae63d386aae21a7","observation_id":"945df162-b2f5-44d2-a95c-3a2f4215717f","resolution":{"observed_at":"2026-06-28T10:14:42.067337Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2511.16624","last_updated":"2025-11-20T18:31:46Z","snapshot_observed_at":"2026-08-13T19:30:37.668913Z","submitted_at":"2025-11-20T18:31:46Z","title":"SAM 3D: 3Dfy Anything in Images","version":1},"cited_work":{"arxiv_id":"2511.16624","doi":"10.48550/arxiv.2511.16624","metadata_source":"pith","pith_arxiv_id":"2511.16624","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"SAM 3D: 3Dfy Anything in Images","venue":"cs.CV","work_id":"dc22e9ff-fcf5-4069-8ace-35ae3a0bfd7c","year":2025},"citing_paper":{"arxiv_id":"2606.04291","last_updated":"2026-06-02T23:41:52Z","snapshot_observed_at":"2026-08-12T18:56:09.302526Z","submitted_at":"2026-06-02T23:41:52Z","title":"A Cookbook of 3D Vision: Data, Learning Paradigms, and Application","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-06-28T10:14:42.067337Z"},"links":{"cited_paper":"/paper/2511.16624","citing_paper":"/paper/2606.04291"},"observation_digest":"sha256:e0efadbba75bf5b902ecb0a5ff86ee6e2689dacf8334603700c49f0669bee9a3","observation_id":"e2c5d413-ee78-4808-9bf4-48dba6c102ec","resolution":{"observed_at":"2026-07-02T03:16:33.499145Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-28T10:14:42.067337Z","title":"Parametric 20000","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2606.04291","last_updated":"2026-06-02T23:41:52Z","snapshot_observed_at":"2026-08-12T18:56:09.302526Z","submitted_at":"2026-06-02T23:41:52Z","title":"A Cookbook of 3D Vision: Data, Learning Paradigms, and Application","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-06-28T10:14:42.067337Z"},"links":{"citing_paper":"/paper/2606.04291"},"observation_digest":"sha256:8b16bc2d8466f44f0fbff71cb04da334a3e1f13bc043c3f79262b5f29113ceb1","observation_id":"a5eb4b19-70b6-438b-8a9c-eb646a80310a","resolution":{"observed_at":"2026-06-28T10:14:42.067337Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-28T10:14:42.067337Z","title":"Robust reconstruction of indoor scenes","venue":null,"work_id":null,"year":2015},"citing_paper":{"arxiv_id":"2606.04291","last_updated":"2026-06-02T23:41:52Z","snapshot_observed_at":"2026-08-12T18:56:09.302526Z","submitted_at":"2026-06-02T23:41:52Z","title":"A Cookbook of 3D Vision: Data, Learning Paradigms, and Application","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-06-28T10:14:42.067337Z"},"links":{"citing_paper":"/paper/2606.04291"},"observation_digest":"sha256:e56dfe1b10ca9450698a2e06215ff026ef98f1e2d4d9888532abbfd4b0713945","observation_id":"5bf4a153-7522-4c81-97a4-aa765a757fb2","resolution":{"observed_at":"2026-06-28T10:14:42.067337Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1602.02481","last_updated":"2016-05-05T05:35:48Z","snapshot_observed_at":"2026-07-06T04:45:26.039485Z","submitted_at":"2016-02-08T07:20:52Z","title":"A Large Dataset of Object Scans","version":3},"cited_work":{"arxiv_id":"1602.02481","doi":null,"metadata_source":"pith","pith_arxiv_id":"1602.02481","snapshot_observed_at":"2026-07-02T03:16:33.507773Z","title":"A Large Dataset of Object Scans","venue":"cs.CV","work_id":"2031ff43-f5c6-4c1a-87a6-985578639823","year":2016},"citing_paper":{"arxiv_id":"2606.04291","last_updated":"2026-06-02T23:41:52Z","snapshot_observed_at":"2026-08-12T18:56:09.302526Z","submitted_at":"2026-06-02T23:41:52Z","title":"A Cookbook of 3D Vision: Data, Learning Paradigms, and Application","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-06-28T10:14:42.067337Z"},"links":{"cited_paper":"/paper/1602.02481","citing_paper":"/paper/2606.04291"},"observation_digest":"sha256:dadc0e6834b6c1525836577929bf23c615ba953a9afe0ee333a6c02318f07d41","observation_id":"63b6679f-65e5-4f13-bff0-a0ec625c45a0","resolution":{"observed_at":"2026-07-02T03:16:33.510126Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-28T10:14:42.067337Z","title":"4d spatio-temporal convnets: Minkowski convolutional neural networks","venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2606.04291","last_updated":"2026-06-02T23:41:52Z","snapshot_observed_at":"2026-08-12T18:56:09.302526Z","submitted_at":"2026-06-02T23:41:52Z","title":"A Cookbook of 3D Vision: Data, Learning Paradigms, and Application","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-06-28T10:14:42.067337Z"},"links":{"citing_paper":"/paper/2606.04291"},"observation_digest":"sha256:e84bd2bf8796c4b849b7626b276a74830a69b9341eaa3a124d72cf7b1ab6dec4","observation_id":"b382d0c2-81c6-4436-be93-9b46ee751622","resolution":{"observed_at":"2026-06-28T10:14:42.067337Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-28T10:14:42.067337Z","title":"Choy, Danfei Xu, JunYoung Gwak, Kevin Chen, and Silvio Savarese","venue":null,"work_id":null,"year":2016},"citing_paper":{"arxiv_id":"2606.04291","last_updated":"2026-06-02T23:41:52Z","snapshot_observed_at":"2026-08-12T18:56:09.302526Z","submitted_at":"2026-06-02T23:41:52Z","title":"A Cookbook of 3D Vision: Data, Learning Paradigms, and Application","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-06-28T10:14:42.067337Z"},"links":{"citing_paper":"/paper/2606.04291"},"observation_digest":"sha256:f16bf590b86451e01c2d95039593b6748b787cd036809e98b80965a0dbad4255","observation_id":"61402f8b-a57e-479f-bf84-8ff742fd790d","resolution":{"observed_at":"2026-06-28T10:14:42.067337Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-28T10:14:42.067337Z","title":"3d u-net: Learning dense volumetric segmentation from sparse annotation","venue":null,"work_id":null,"year":2016},"citing_paper":{"arxiv_id":"2606.04291","last_updated":"2026-06-02T23:41:52Z","snapshot_observed_at":"2026-08-12T18:56:09.302526Z","submitted_at":"2026-06-02T23:41:52Z","title":"A Cookbook of 3D Vision: Data, Learning Paradigms, and Application","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-06-28T10:14:42.067337Z"},"links":{"citing_paper":"/paper/2606.04291"},"observation_digest":"sha256:f0089f694bb4de15abc2ef34c4a78bff78a65a23786b1dd2109c1b23a307f030","observation_id":"79e4897a-9b08-4e70-b63d-8ac15356e7a2","resolution":{"observed_at":"2026-06-28T10:14:42.067337Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-28T10:14:42.067337Z","title":"Abo: Dataset and benchmarks for real-world 3d object understanding.CVPR, 2022","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2606.04291","last_updated":"2026-06-02T23:41:52Z","snapshot_observed_at":"2026-08-12T18:56:09.302526Z","submitted_at":"2026-06-02T23:41:52Z","title":"A Cookbook of 3D Vision: Data, Learning Paradigms, and Application","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-06-28T10:14:42.067337Z"},"links":{"citing_paper":"/paper/2606.04291"},"observation_digest":"sha256:71a924028c70fb0d4b08d181d00c2e427fe52328cd51d713bb1963128e1ae267","observation_id":"03e3227b-67e5-4072-87c5-efb887adee21","resolution":{"observed_at":"2026-06-28T10:14:42.067337Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-28T10:14:42.067337Z","title":null,"venue":null,"work_id":null,"year":1972},"citing_paper":{"arxiv_id":"2606.04291","last_updated":"2026-06-02T23:41:52Z","snapshot_observed_at":"2026-08-12T18:56:09.302526Z","submitted_at":"2026-06-02T23:41:52Z","title":"A Cookbook of 3D Vision: Data, Learning Paradigms, and Application","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-06-28T10:14:42.067337Z"},"links":{"citing_paper":"/paper/2606.04291"},"observation_digest":"sha256:fa3385f7b02e461e245919d3921dad55d8ad036018396d90293e0643adf71a3a","observation_id":"feadca92-3cd6-4e5e-a9b0-be3de036def7","resolution":{"observed_at":"2026-06-28T10:14:42.067337Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-28T10:14:42.067337Z","title":"Scannet: Richly-annotated 3d reconstructions of indoor scenes","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2606.04291","last_updated":"2026-06-02T23:41:52Z","snapshot_observed_at":"2026-08-12T18:56:09.302526Z","submitted_at":"2026-06-02T23:41:52Z","title":"A Cookbook of 3D Vision: Data, Learning Paradigms, and Application","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-06-28T10:14:42.067337Z"},"links":{"citing_paper":"/paper/2606.04291"},"observation_digest":"sha256:51170245e037c74ef120d56ccd3c8b257c7f30d6fcd5e9347cfc488377a62a5a","observation_id":"127fa7db-5ac1-4061-a66e-223977f0d0b9","resolution":{"observed_at":"2026-06-28T10:14:42.067337Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-28T10:14:42.067337Z","title":"Bundlefusion: Real- time globally consistent 3d reconstruction using on-the-fly surface reintegration.ACM Transactions on Graphics (TOG), 36(4):1–18, 2017","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2606.04291","last_updated":"2026-06-02T23:41:52Z","snapshot_observed_at":"2026-08-12T18:56:09.302526Z","submitted_at":"2026-06-02T23:41:52Z","title":"A Cookbook of 3D Vision: Data, Learning Paradigms, and Application","version":1},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-06-28T10:14:42.067337Z"},"links":{"citing_paper":"/paper/2606.04291"},"observation_digest":"sha256:9ae9abd59bd95652bb66db52c2a995c165e07bfea30a59a96a4c47ae4aff1178","observation_id":"8f59e07a-5d13-46ec-b4bd-0128d6d1802a","resolution":{"observed_at":"2026-06-28T10:14:42.067337Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-28T10:14:42.067337Z","title":"Scancomplete: Large-scale scene completion and semantic segmentation for 3d scans","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2606.04291","last_updated":"2026-06-02T23:41:52Z","snapshot_observed_at":"2026-08-12T18:56:09.302526Z","submitted_at":"2026-06-02T23:41:52Z","title":"A Cookbook of 3D Vision: Data, Learning Paradigms, and Application","version":1},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-06-28T10:14:42.067337Z"},"links":{"citing_paper":"/paper/2606.04291"},"observation_digest":"sha256:82fc3acace577aa9edd9f9775d228069daf62793629fe571e93adfa1e0be6b23","observation_id":"f7a8b9d1-60db-4773-b6e5-722c2197c644","resolution":{"observed_at":"2026-06-28T10:14:42.067337Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-28T10:14:42.067337Z","title":"Brepformer: Transformer-based b-rep geometric feature recognition","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2606.04291","last_updated":"2026-06-02T23:41:52Z","snapshot_observed_at":"2026-08-12T18:56:09.302526Z","submitted_at":"2026-06-02T23:41:52Z","title":"A Cookbook of 3D Vision: Data, Learning Paradigms, and Application","version":1},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-06-28T10:14:42.067337Z"},"links":{"citing_paper":"/paper/2606.04291"},"observation_digest":"sha256:85defdadc1bf47fbc94a41609cde0068965086809e1381d763d1dae19f2365c8","observation_id":"8285eeb4-b179-4e7d-a825-0c842c0cfa52","resolution":{"observed_at":"2026-06-28T10:14:42.067337Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-28T10:14:42.067337Z","title":"Springer, New York, revised 2001 edition, 1978","venue":null,"work_id":null,"year":2001},"citing_paper":{"arxiv_id":"2606.04291","last_updated":"2026-06-02T23:41:52Z","snapshot_observed_at":"2026-08-12T18:56:09.302526Z","submitted_at":"2026-06-02T23:41:52Z","title":"A Cookbook of 3D Vision: Data, Learning Paradigms, and Application","version":1},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-06-28T10:14:42.067337Z"},"links":{"citing_paper":"/paper/2606.04291"},"observation_digest":"sha256:b3270317c1d8c0c4ee88e2705457a90d7ff2721420564dab4a642b095f49c7fd","observation_id":"c1dc88ad-9b06-4e5c-8043-c9d28cbd8790","resolution":{"observed_at":"2026-06-28T10:14:42.067337Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2307.05663","last_updated":"2023-07-11T17:57:40Z","snapshot_observed_at":"2026-07-06T15:52:52.180267Z","submitted_at":"2023-07-11T17:57:40Z","title":"Objaverse-XL: A Universe of 10M+ 3D Objects","version":1},"cited_work":{"arxiv_id":"2307.05663","doi":"10.48550/arxiv.2307.05663","metadata_source":"pith","pith_arxiv_id":"2307.05663","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Objaverse-XL: A Universe of 10M+ 3D Objects","venue":"cs.CV","work_id":"1c5475ad-d1ec-4de1-8670-b8cd5a4c85d3","year":2023},"citing_paper":{"arxiv_id":"2606.04291","last_updated":"2026-06-02T23:41:52Z","snapshot_observed_at":"2026-08-12T18:56:09.302526Z","submitted_at":"2026-06-02T23:41:52Z","title":"A Cookbook of 3D Vision: Data, Learning Paradigms, and Application","version":1},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-06-28T10:14:42.067337Z"},"links":{"cited_paper":"/paper/2307.05663","citing_paper":"/paper/2606.04291"},"observation_digest":"sha256:c9da77e44c4a5237d42b2689deee168455c7e4c1f607e4f42d87e406d5728e7e","observation_id":"a9b2bd81-77c1-47d2-9490-1181b0a429d4","resolution":{"observed_at":"2026-07-02T03:16:33.537620Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-28T10:14:42.067337Z","title":"Videogpa: Distilling geometry priors for 3d-consistent video generation, 2026","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2606.04291","last_updated":"2026-06-02T23:41:52Z","snapshot_observed_at":"2026-08-12T18:56:09.302526Z","submitted_at":"2026-06-02T23:41:52Z","title":"A Cookbook of 3D Vision: Data, Learning Paradigms, and Application","version":1},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-06-28T10:14:42.067337Z"},"links":{"citing_paper":"/paper/2606.04291"},"observation_digest":"sha256:ef23486760e1fe4418b4d350394c7bdb86e45eae665ad751778983b461e46a99","observation_id":"96f9f9af-dd8d-4760-9895-17af1aec995d","resolution":{"observed_at":"2026-06-28T10:14:42.067337Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-28T10:14:42.067337Z","title":"The mapillary traffic sign dataset for detection and classification on a global scale, 2020","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2606.04291","last_updated":"2026-06-02T23:41:52Z","snapshot_observed_at":"2026-08-12T18:56:09.302526Z","submitted_at":"2026-06-02T23:41:52Z","title":"A Cookbook of 3D Vision: Data, Learning Paradigms, and Application","version":1},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-06-28T10:14:42.067337Z"},"links":{"citing_paper":"/paper/2606.04291"},"observation_digest":"sha256:001cf1c3edb7e94de026f528045ac2be2f9dccb9366751de804c6abd6c453cfc","observation_id":"7795179f-97e7-447a-887c-56b674f3d7fc","resolution":{"observed_at":"2026-06-28T10:14:42.067337Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-28T10:14:42.067337Z","title":"A point set generation network for 3d object reconstruction from a single image, 2016","venue":null,"work_id":null,"year":2016},"citing_paper":{"arxiv_id":"2606.04291","last_updated":"2026-06-02T23:41:52Z","snapshot_observed_at":"2026-08-12T18:56:09.302526Z","submitted_at":"2026-06-02T23:41:52Z","title":"A Cookbook of 3D Vision: Data, Learning Paradigms, and Application","version":1},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-06-28T10:14:42.067337Z"},"links":{"citing_paper":"/paper/2606.04291"},"observation_digest":"sha256:c284066ffa6defda3f7ff1911b378d06beb4f07ad01cea37d08d8d7e0f4a12ba","observation_id":"5fe0bfca-8a8d-4436-9dff-0b4d11887d1c","resolution":{"observed_at":"2026-06-28T10:14:42.067337Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-28T10:14:42.067337Z","title":"A history-based parametric cad sketch dataset with advanced engineering commands.Computer-Aided Design, 182:103848, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2606.04291","last_updated":"2026-06-02T23:41:52Z","snapshot_observed_at":"2026-08-12T18:56:09.302526Z","submitted_at":"2026-06-02T23:41:52Z","title":"A Cookbook of 3D Vision: Data, Learning Paradigms, and Application","version":1},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-06-28T10:14:42.067337Z"},"links":{"citing_paper":"/paper/2606.04291"},"observation_digest":"sha256:e72d5dd0b0b48b79fa14842dde72295b6d0b375876d59096efa6b264e45b09fa","observation_id":"ec32db66-6cb3-4870-bcbe-621ad401fac3","resolution":{"observed_at":"2026-06-28T10:14:42.067337Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-28T10:14:42.067337Z","title":"Morgan Kaufmann, San Diego, 5 edition, 2002","venue":null,"work_id":null,"year":2002},"citing_paper":{"arxiv_id":"2606.04291","last_updated":"2026-06-02T23:41:52Z","snapshot_observed_at":"2026-08-12T18:56:09.302526Z","submitted_at":"2026-06-02T23:41:52Z","title":"A Cookbook of 3D Vision: Data, Learning Paradigms, and Application","version":1},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-06-28T10:14:42.067337Z"},"links":{"citing_paper":"/paper/2606.04291"},"observation_digest":"sha256:9a8df11e719a8136e6cc7611b9b34c8b8b4fdc5f01cb667dee92c447980bb7d9","observation_id":"0ea04d8f-4e02-4907-9a7b-f0ff9da6e7d7","resolution":{"observed_at":"2026-06-28T10:14:42.067337Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-28T10:14:42.067337Z","title":null,"venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2606.04291","last_updated":"2026-06-02T23:41:52Z","snapshot_observed_at":"2026-08-12T18:56:09.302526Z","submitted_at":"2026-06-02T23:41:52Z","title":"A Cookbook of 3D Vision: Data, Learning Paradigms, and Application","version":1},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-06-28T10:14:42.067337Z"},"links":{"citing_paper":"/paper/2606.04291"},"observation_digest":"sha256:18d4bdc76651146d0fcbf407a91bfb4795143ae7f21379cab73c5892e3166cf1","observation_id":"33bb3765-ec77-4cb7-a0cd-bc5ba84ac415","resolution":{"observed_at":"2026-06-28T10:14:42.067337Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-28T10:14:42.067337Z","title":"3d-future: 3d furniture shape with texture, 2020","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2606.04291","last_updated":"2026-06-02T23:41:52Z","snapshot_observed_at":"2026-08-12T18:56:09.302526Z","submitted_at":"2026-06-02T23:41:52Z","title":"A Cookbook of 3D Vision: Data, Learning Paradigms, and Application","version":1},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-06-28T10:14:42.067337Z"},"links":{"citing_paper":"/paper/2606.04291"},"observation_digest":"sha256:102960ecff9bb7f67314fb50046fbd47536bc115fb88712ab5c113e6d13803e2","observation_id":"5367b57b-5306-444f-8306-d185ba4a9540","resolution":{"observed_at":"2026-06-28T10:14:42.067337Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-28T10:14:42.067337Z","title":"3d-front: 3d furnished rooms with layouts and semantics, 2021","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2606.04291","last_updated":"2026-06-02T23:41:52Z","snapshot_observed_at":"2026-08-12T18:56:09.302526Z","submitted_at":"2026-06-02T23:41:52Z","title":"A Cookbook of 3D Vision: Data, Learning Paradigms, and Application","version":1},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-06-28T10:14:42.067337Z"},"links":{"citing_paper":"/paper/2606.04291"},"observation_digest":"sha256:449a9a97978beb73bf7ac7546c0148dbffa365717b084c0dae423d36ea2e712b","observation_id":"ee4959ec-f3c8-4508-8e20-4af67c3eb0a5","resolution":{"observed_at":"2026-06-28T10:14:42.067337Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-28T10:14:42.067337Z","title":"Anyhome: Open-vocabulary generation of structured and textured 3d homes, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2606.04291","last_updated":"2026-06-02T23:41:52Z","snapshot_observed_at":"2026-08-12T18:56:09.302526Z","submitted_at":"2026-06-02T23:41:52Z","title":"A Cookbook of 3D Vision: Data, Learning Paradigms, and Application","version":1},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-06-28T10:14:42.067337Z"},"links":{"citing_paper":"/paper/2606.04291"},"observation_digest":"sha256:93f773ae952c51ae465ef7f06e7136c54ebf03c2de40bc15ce461ac2f958961c","observation_id":"39e97e92-45cc-4a7f-a6f4-f660ceab69f9","resolution":{"observed_at":"2026-06-28T10:14:42.067337Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-28T10:14:42.067337Z","title":"Gigahands: A massive annotated dataset of bimanual hand activities","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2606.04291","last_updated":"2026-06-02T23:41:52Z","snapshot_observed_at":"2026-08-12T18:56:09.302526Z","submitted_at":"2026-06-02T23:41:52Z","title":"A Cookbook of 3D Vision: Data, Learning Paradigms, and Application","version":1},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-06-28T10:14:42.067337Z"},"links":{"citing_paper":"/paper/2606.04291"},"observation_digest":"sha256:ef9cbe19cd1440dd8c22b399b9a78224c4184453bff8dc3354a020cf5629eec0","observation_id":"baea0d1e-2f13-4e66-abf7-170a9d5656da","resolution":{"observed_at":"2026-06-28T10:14:42.067337Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-28T10:14:42.067337Z","title":"Efros, and Xiaolong Wang","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2606.04291","last_updated":"2026-06-02T23:41:52Z","snapshot_observed_at":"2026-08-12T18:56:09.302526Z","submitted_at":"2026-06-02T23:41:52Z","title":"A Cookbook of 3D Vision: Data, Learning Paradigms, and Application","version":1},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-06-28T10:14:42.067337Z"},"links":{"citing_paper":"/paper/2606.04291"},"observation_digest":"sha256:f6589cfc5e8c087026ca9952c534053165b3a1c5cc3e70523aa69fb0a130e682","observation_id":"115d2fc7-bdc5-4e7d-b0d5-e50c3798ec44","resolution":{"observed_at":"2026-06-28T10:14:42.067337Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-28T10:14:42.067337Z","title":"Accurate, dense, and robust multi-view stereopsis.IEEE Trans","venue":null,"work_id":null,"year":2010},"citing_paper":{"arxiv_id":"2606.04291","last_updated":"2026-06-02T23:41:52Z","snapshot_observed_at":"2026-08-12T18:56:09.302526Z","submitted_at":"2026-06-02T23:41:52Z","title":"A Cookbook of 3D Vision: Data, Learning Paradigms, and Application","version":1},"reference_index":36,"source":"pdf_text","source_observed_at":"2026-06-28T10:14:42.067337Z"},"links":{"citing_paper":"/paper/2606.04291"},"observation_digest":"sha256:bdd051df98c281b50da8eb40960eca8c2db99e31955fa287918d22bd2c0626cf","observation_id":"04fe14a1-1f32-4243-8150-1bcd2ab2f2dd","resolution":{"observed_at":"2026-06-28T10:14:42.067337Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-28T10:14:42.067337Z","title":"Virtual worlds as proxy for multi-object tracking analysis, 2016","venue":null,"work_id":null,"year":2016},"citing_paper":{"arxiv_id":"2606.04291","last_updated":"2026-06-02T23:41:52Z","snapshot_observed_at":"2026-08-12T18:56:09.302526Z","submitted_at":"2026-06-02T23:41:52Z","title":"A Cookbook of 3D Vision: Data, Learning Paradigms, and Application","version":1},"reference_index":37,"source":"pdf_text","source_observed_at":"2026-06-28T10:14:42.067337Z"},"links":{"citing_paper":"/paper/2606.04291"},"observation_digest":"sha256:7011edb211b0566e048e8dd847750637cfdfce51827e6bc73feb39f3d942b266","observation_id":"330691de-a59a-4406-8144-3d6e1698f2e7","resolution":{"observed_at":"2026-06-28T10:14:42.067337Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-28T10:14:42.067337Z","title":"Nerf: Neural radiance field in 3d vision: A comprehensive review (updated post-gaussian splatting), 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2606.04291","last_updated":"2026-06-02T23:41:52Z","snapshot_observed_at":"2026-08-12T18:56:09.302526Z","submitted_at":"2026-06-02T23:41:52Z","title":"A Cookbook of 3D Vision: Data, Learning Paradigms, and Application","version":1},"reference_index":38,"source":"pdf_text","source_observed_at":"2026-06-28T10:14:42.067337Z"},"links":{"citing_paper":"/paper/2606.04291"},"observation_digest":"sha256:0f74232a6789649c80719490ea8b87b5a2b28990164e85674a19d323cf3583ca","observation_id":"19518a10-9d14-4d6f-aa59-d1adde1d81a4","resolution":{"observed_at":"2026-06-28T10:14:42.067337Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-28T10:14:42.067337Z","title":"Submanifold sparse convolutional networks","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2606.04291","last_updated":"2026-06-02T23:41:52Z","snapshot_observed_at":"2026-08-12T18:56:09.302526Z","submitted_at":"2026-06-02T23:41:52Z","title":"A Cookbook of 3D Vision: Data, Learning Paradigms, and Application","version":1},"reference_index":39,"source":"pdf_text","source_observed_at":"2026-06-28T10:14:42.067337Z"},"links":{"citing_paper":"/paper/2606.04291"},"observation_digest":"sha256:b02f64054a7a8bf6a90fc8f5591fea360741e2a5086987dcf629e184704ed8c6","observation_id":"9f54daf6-d0a3-401d-812f-77fa0a5941a3","resolution":{"observed_at":"2026-06-28T10:14:42.067337Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-28T10:14:42.067337Z","title":"Ego-exo4d: Understanding skilled human activity from first-and third-person perspectives","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2606.04291","last_updated":"2026-06-02T23:41:52Z","snapshot_observed_at":"2026-08-12T18:56:09.302526Z","submitted_at":"2026-06-02T23:41:52Z","title":"A Cookbook of 3D Vision: Data, Learning Paradigms, and Application","version":1},"reference_index":40,"source":"pdf_text","source_observed_at":"2026-06-28T10:14:42.067337Z"},"links":{"citing_paper":"/paper/2606.04291"},"observation_digest":"sha256:df1ee537a718cbdb9bc614e98976508127c8386bc6529b1fc4a79958cfe75735","observation_id":"9615cafc-8e17-4ed0-a9cd-caa72849db67","resolution":{"observed_at":"2026-06-28T10:14:42.067337Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-28T10:14:42.067337Z","title":null,"venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2606.04291","last_updated":"2026-06-02T23:41:52Z","snapshot_observed_at":"2026-08-12T18:56:09.302526Z","submitted_at":"2026-06-02T23:41:52Z","title":"A Cookbook of 3D Vision: Data, Learning Paradigms, and Application","version":1},"reference_index":41,"source":"pdf_text","source_observed_at":"2026-06-28T10:14:42.067337Z"},"links":{"citing_paper":"/paper/2606.04291"},"observation_digest":"sha256:6cdd304211c89b78ca2d91bfe0f5ef3bb2524f06d586d53fad0ef676cd69b898","observation_id":"87e96bdf-ab80-4812-89b5-15ef1cc5fa72","resolution":{"observed_at":"2026-06-28T10:14:42.067337Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-28T10:14:42.067337Z","title":"Diffusion as shader: 3d-aware video diffusion for versatile video generation control, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2606.04291","last_updated":"2026-06-02T23:41:52Z","snapshot_observed_at":"2026-08-12T18:56:09.302526Z","submitted_at":"2026-06-02T23:41:52Z","title":"A Cookbook of 3D Vision: Data, Learning Paradigms, and Application","version":1},"reference_index":42,"source":"pdf_text","source_observed_at":"2026-06-28T10:14:42.067337Z"},"links":{"citing_paper":"/paper/2606.04291"},"observation_digest":"sha256:ce5818cd653ad24e7a4b3f51f13887ab47469ef2f6f25c114e4194814031dcf6","observation_id":"95b466fd-638d-4e0a-a188-ed51bb5b2a8d","resolution":{"observed_at":"2026-06-28T10:14:42.067337Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-28T10:14:42.067337Z","title":"Roca: Robust cad model retrieval and alignment from a single image","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2606.04291","last_updated":"2026-06-02T23:41:52Z","snapshot_observed_at":"2026-08-12T18:56:09.302526Z","submitted_at":"2026-06-02T23:41:52Z","title":"A Cookbook of 3D Vision: Data, Learning Paradigms, and Application","version":1},"reference_index":43,"source":"pdf_text","source_observed_at":"2026-06-28T10:14:42.067337Z"},"links":{"citing_paper":"/paper/2606.04291"},"observation_digest":"sha256:bc2e077e348416535a25599852cff99ca00db8e5200b78edfeb974373e991529","observation_id":"ec809303-629f-4c86-b871-a618e92a231b","resolution":{"observed_at":"2026-06-28T10:14:42.067337Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-28T10:14:42.067337Z","title":"Martin, and Shi-Min Hu","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2606.04291","last_updated":"2026-06-02T23:41:52Z","snapshot_observed_at":"2026-08-12T18:56:09.302526Z","submitted_at":"2026-06-02T23:41:52Z","title":"A Cookbook of 3D Vision: Data, Learning Paradigms, and Application","version":1},"reference_index":44,"source":"pdf_text","source_observed_at":"2026-06-28T10:14:42.067337Z"},"links":{"citing_paper":"/paper/2606.04291"},"observation_digest":"sha256:20557004883894a48ecc8f8bd180332ac5dd54ec0597793770d6ba1dc7c9e9bf","observation_id":"80cc981e-9f72-484e-8cad-c34a53f1db1f","resolution":{"observed_at":"2026-06-28T10:14:42.067337Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-28T10:14:42.067337Z","title":"Learning rich features from rgb-d images for object detection and segmentation","venue":null,"work_id":null,"year":2014},"citing_paper":{"arxiv_id":"2606.04291","last_updated":"2026-06-02T23:41:52Z","snapshot_observed_at":"2026-08-12T18:56:09.302526Z","submitted_at":"2026-06-02T23:41:52Z","title":"A Cookbook of 3D Vision: Data, Learning Paradigms, and Application","version":1},"reference_index":45,"source":"pdf_text","source_observed_at":"2026-06-28T10:14:42.067337Z"},"links":{"citing_paper":"/paper/2606.04291"},"observation_digest":"sha256:953e8941bfaa0727fdb9e4b228c53d7069d12e4e20eedbfc066509839fd44f87","observation_id":"031177db-c554-4ec5-89bb-336a11f6dc34","resolution":{"observed_at":"2026-06-28T10:14:42.067337Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-28T10:14:42.067337Z","title":"Savinov, L","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2606.04291","last_updated":"2026-06-02T23:41:52Z","snapshot_observed_at":"2026-08-12T18:56:09.302526Z","submitted_at":"2026-06-02T23:41:52Z","title":"A Cookbook of 3D Vision: Data, Learning Paradigms, and Application","version":1},"reference_index":46,"source":"pdf_text","source_observed_at":"2026-06-28T10:14:42.067337Z"},"links":{"citing_paper":"/paper/2606.04291"},"observation_digest":"sha256:3857549e514a8dcca822341806e189318c8de6fec4208b3be7900c44b5cd8f83","observation_id":"e8cfe5cc-1d20-458f-b2b5-6e05d0885bcd","resolution":{"observed_at":"2026-06-28T10:14:42.067337Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-28T10:14:42.067337Z","title":"Dual transformer for point cloud analysis","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2606.04291","last_updated":"2026-06-02T23:41:52Z","snapshot_observed_at":"2026-08-12T18:56:09.302526Z","submitted_at":"2026-06-02T23:41:52Z","title":"A Cookbook of 3D Vision: Data, Learning Paradigms, and Application","version":1},"reference_index":47,"source":"pdf_text","source_observed_at":"2026-06-28T10:14:42.067337Z"},"links":{"citing_paper":"/paper/2606.04291"},"observation_digest":"sha256:ac3f4e304c7b20edce1577de68bef1e85f81e7ff7628d3bf4d1c71f126141d45","observation_id":"641e8ebb-f4e0-4c6f-a9ad-d5fb0b986fa4","resolution":{"observed_at":"2026-06-28T10:14:42.067337Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-28T10:14:42.067337Z","title":"Meshcnn: A network with an edge","venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2606.04291","last_updated":"2026-06-02T23:41:52Z","snapshot_observed_at":"2026-08-12T18:56:09.302526Z","submitted_at":"2026-06-02T23:41:52Z","title":"A Cookbook of 3D Vision: Data, Learning Paradigms, and Application","version":1},"reference_index":48,"source":"pdf_text","source_observed_at":"2026-06-28T10:14:42.067337Z"},"links":{"citing_paper":"/paper/2606.04291"},"observation_digest":"sha256:b86f91c9ab1b7228a58ab86c198eef51b124cfeae49ad9febe212d3d6b5d94f8","observation_id":"cf4b530e-0429-4e8d-9c9e-d27841b68cca","resolution":{"observed_at":"2026-06-28T10:14:42.067337Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-28T10:14:42.067337Z","title":"Deep learning based 3d segmentation: A survey, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2606.04291","last_updated":"2026-06-02T23:41:52Z","snapshot_observed_at":"2026-08-12T18:56:09.302526Z","submitted_at":"2026-06-02T23:41:52Z","title":"A Cookbook of 3D Vision: Data, Learning Paradigms, and Application","version":1},"reference_index":49,"source":"pdf_text","source_observed_at":"2026-06-28T10:14:42.067337Z"},"links":{"citing_paper":"/paper/2606.04291"},"observation_digest":"sha256:381f9dd4585450b69143b98163a3d041be1f28326925dfebcb4192bcf79e355a","observation_id":"4ad60ea1-8318-4f3a-bb80-d3c609ff9523","resolution":{"observed_at":"2026-06-28T10:14:42.067337Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-28T10:14:42.067337Z","title":"Rgb-d mapping: Using depth cameras for dense 3d modeling of indoor environments.The International Journal of Robotics Research, 31(5):647–663, 2012","venue":null,"work_id":null,"year":2012},"citing_paper":{"arxiv_id":"2606.04291","last_updated":"2026-06-02T23:41:52Z","snapshot_observed_at":"2026-08-12T18:56:09.302526Z","submitted_at":"2026-06-02T23:41:52Z","title":"A Cookbook of 3D Vision: Data, Learning Paradigms, and Application","version":1},"reference_index":50,"source":"pdf_text","source_observed_at":"2026-06-28T10:14:42.067337Z"},"links":{"citing_paper":"/paper/2606.04291"},"observation_digest":"sha256:d8e7b47cac2d2c6fe88e0d08917f5a498e57b22c88927a88f2e82aad30e0e770","observation_id":"7068767a-3a14-4515-9f26-5cc782da8dec","resolution":{"observed_at":"2026-06-28T10:14:42.067337Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-28T10:14:42.067337Z","title":"Hoffmann.Geometric and Solid Modeling: An Introduction","venue":null,"work_id":null,"year":1989},"citing_paper":{"arxiv_id":"2606.04291","last_updated":"2026-06-02T23:41:52Z","snapshot_observed_at":"2026-08-12T18:56:09.302526Z","submitted_at":"2026-06-02T23:41:52Z","title":"A Cookbook of 3D Vision: Data, Learning Paradigms, and Application","version":1},"reference_index":51,"source":"pdf_text","source_observed_at":"2026-06-28T10:14:42.067337Z"},"links":{"citing_paper":"/paper/2606.04291"},"observation_digest":"sha256:5405e410e972172291607922926473941d60ebba57e11956079c50cceb35a217","observation_id":"4e7d30a0-3d50-428e-94de-f8c901c1d213","resolution":{"observed_at":"2026-06-28T10:14:42.067337Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-28T10:14:42.067337Z","title":"Pf3plat: Pose-free feed-forward 3d gaussian splatting, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2606.04291","last_updated":"2026-06-02T23:41:52Z","snapshot_observed_at":"2026-08-12T18:56:09.302526Z","submitted_at":"2026-06-02T23:41:52Z","title":"A Cookbook of 3D Vision: Data, Learning Paradigms, and Application","version":1},"reference_index":52,"source":"pdf_text","source_observed_at":"2026-06-28T10:14:42.067337Z"},"links":{"citing_paper":"/paper/2606.04291"},"observation_digest":"sha256:587f58b77e71968b6e0bb0d91eebcbd10e73abb06c81a867bb9a1cc416c9b8b5","observation_id":"385fb1ea-54be-4acc-bcdf-0f1ab0a5a8e7","resolution":{"observed_at":"2026-06-28T10:14:42.067337Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2205.15868","last_updated":"2022-05-29T19:02:15Z","snapshot_observed_at":"2026-08-12T19:21:15.526321Z","submitted_at":"2022-05-29T19:02:15Z","title":"CogVideo: Large-scale Pretraining for Text-to-Video Generation via Transformers","version":1},"cited_work":{"arxiv_id":"2205.15868","doi":"10.48550/arxiv.2205.15868","metadata_source":"pith","pith_arxiv_id":"2205.15868","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"CogVideo: Large-scale Pretraining for Text-to-Video Generation via Transformers","venue":"cs.CV","work_id":"2dbd6bcd-fc98-4fbf-b586-f6d94fe1abd2","year":2022},"citing_paper":{"arxiv_id":"2606.04291","last_updated":"2026-06-02T23:41:52Z","snapshot_observed_at":"2026-08-12T18:56:09.302526Z","submitted_at":"2026-06-02T23:41:52Z","title":"A Cookbook of 3D Vision: Data, Learning Paradigms, and Application","version":1},"reference_index":53,"source":"pdf_text","source_observed_at":"2026-06-28T10:14:42.067337Z"},"links":{"cited_paper":"/paper/2205.15868","citing_paper":"/paper/2606.04291"},"observation_digest":"sha256:6f38b69250387429a8c946c76fd6e84888f2087e5d5648455c71e28d9338cf03","observation_id":"e6c00032-87eb-47aa-b4ad-fc1b3cc00daf","resolution":{"observed_at":"2026-07-02T03:16:33.520128Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2311.04400","last_updated":"2024-03-09T10:47:51Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2023-11-08T00:03:52Z","title":"LRM: Large Reconstruction Model for Single Image to 3D","version":2},"cited_work":{"arxiv_id":"2311.04400","doi":null,"metadata_source":"pith","pith_arxiv_id":"2311.04400","snapshot_observed_at":"2026-07-09T18:46:26.549595Z","title":"LRM: Large Reconstruction Model for Single Image to 3D","venue":"cs.CV","work_id":"0662dc2c-cc1c-4358-99bd-2a5f34795738","year":2023},"citing_paper":{"arxiv_id":"2606.04291","last_updated":"2026-06-02T23:41:52Z","snapshot_observed_at":"2026-08-12T18:56:09.302526Z","submitted_at":"2026-06-02T23:41:52Z","title":"A Cookbook of 3D Vision: Data, Learning Paradigms, and Application","version":1},"reference_index":54,"source":"pdf_text","source_observed_at":"2026-06-28T10:14:42.067337Z"},"links":{"cited_paper":"/paper/2311.04400","citing_paper":"/paper/2606.04291"},"observation_digest":"sha256:45589c6501300b2a09bfeb8787878f210ddbd2e707ad196bd336720d928cdf92","observation_id":"db9551cd-24a4-4c50-9199-7a35516181d2","resolution":{"observed_at":"2026-07-02T03:16:33.528580Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-28T10:14:42.067337Z","title":"3d-llm: Injecting the 3d world into large language models.Advances in Neural Information Processing Systems, 36, 2023","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2606.04291","last_updated":"2026-06-02T23:41:52Z","snapshot_observed_at":"2026-08-12T18:56:09.302526Z","submitted_at":"2026-06-02T23:41:52Z","title":"A Cookbook of 3D Vision: Data, Learning Paradigms, and Application","version":1},"reference_index":55,"source":"pdf_text","source_observed_at":"2026-06-28T10:14:42.067337Z"},"links":{"citing_paper":"/paper/2606.04291"},"observation_digest":"sha256:f16eb6a6ef6d0f5e52a5a13bbe851b3a9cb183db5fa4f9271b29774a6ddaf166","observation_id":"5745cae9-95b3-4590-8ff4-74e853529090","resolution":{"observed_at":"2026-06-28T10:14:42.067337Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-28T10:14:42.067337Z","title":"Scenenn: A scene meshes dataset with annotations","venue":null,"work_id":null,"year":2016},"citing_paper":{"arxiv_id":"2606.04291","last_updated":"2026-06-02T23:41:52Z","snapshot_observed_at":"2026-08-12T18:56:09.302526Z","submitted_at":"2026-06-02T23:41:52Z","title":"A Cookbook of 3D Vision: Data, Learning Paradigms, and Application","version":1},"reference_index":56,"source":"pdf_text","source_observed_at":"2026-06-28T10:14:42.067337Z"},"links":{"citing_paper":"/paper/2606.04291"},"observation_digest":"sha256:2576a1e25eb9706f206f0c84806d4c16063746d6a766f6e48769b0d1f6b6a87a","observation_id":"511baaa7-342c-4c17-a863-d8d6100863e2","resolution":{"observed_at":"2026-06-28T10:14:42.067337Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-28T10:14:42.067337Z","title":"An embodied generalist agent in 3d world","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2606.04291","last_updated":"2026-06-02T23:41:52Z","snapshot_observed_at":"2026-08-12T18:56:09.302526Z","submitted_at":"2026-06-02T23:41:52Z","title":"A Cookbook of 3D Vision: Data, Learning Paradigms, and Application","version":1},"reference_index":57,"source":"pdf_text","source_observed_at":"2026-06-28T10:14:42.067337Z"},"links":{"citing_paper":"/paper/2606.04291"},"observation_digest":"sha256:aefbce558fd66c29c5e0277db93a27e4a805c3dc2fb243011c62cf7104d9aec0","observation_id":"9240f148-c696-4cd4-9563-047c41f9a76c","resolution":{"observed_at":"2026-06-28T10:14:42.067337Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-28T10:14:42.067337Z","title":"Deepmvs: Learning multi-view stereopsis","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2606.04291","last_updated":"2026-06-02T23:41:52Z","snapshot_observed_at":"2026-08-12T18:56:09.302526Z","submitted_at":"2026-06-02T23:41:52Z","title":"A Cookbook of 3D Vision: Data, Learning Paradigms, and Application","version":1},"reference_index":58,"source":"pdf_text","source_observed_at":"2026-06-28T10:14:42.067337Z"},"links":{"citing_paper":"/paper/2606.04291"},"observation_digest":"sha256:f02ae07485d3ea30ec259f3d217e4ddf48d142c14cc73d6d12374827effdd47c","observation_id":"18908d1c-e697-42b6-8cac-7e867c297e22","resolution":{"observed_at":"2026-06-28T10:14:42.067337Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-28T10:14:42.067337Z","title":"Particleformer: A 3d point cloud world model for multi-object, multi-material robotic manipulation, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2606.04291","last_updated":"2026-06-02T23:41:52Z","snapshot_observed_at":"2026-08-12T18:56:09.302526Z","submitted_at":"2026-06-02T23:41:52Z","title":"A Cookbook of 3D Vision: Data, Learning Paradigms, and Application","version":1},"reference_index":59,"source":"pdf_text","source_observed_at":"2026-06-28T10:14:42.067337Z"},"links":{"citing_paper":"/paper/2606.04291"},"observation_digest":"sha256:61d885fada16156221d969333269901f513115aefcda3c383103d259d1b7495d","observation_id":"d436d15f-004e-46a8-8cf2-4796d629f0d2","resolution":{"observed_at":"2026-06-28T10:14:42.067337Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-28T10:14:42.067337Z","title":"Pointworld: Scaling 3d world models for in-the-wild robotic manipulation, 2026","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2606.04291","last_updated":"2026-06-02T23:41:52Z","snapshot_observed_at":"2026-08-12T18:56:09.302526Z","submitted_at":"2026-06-02T23:41:52Z","title":"A Cookbook of 3D Vision: Data, Learning Paradigms, and Application","version":1},"reference_index":60,"source":"pdf_text","source_observed_at":"2026-06-28T10:14:42.067337Z"},"links":{"citing_paper":"/paper/2606.04291"},"observation_digest":"sha256:ab8d8d01f110109ec1a2af0f8e86141130d13d66f1f7514c8e9f9f66d889b052","observation_id":"7cfe3561-0044-4f61-8d2a-14ee8158d92a","resolution":{"observed_at":"2026-06-28T10:14:42.067337Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-28T10:14:42.067337Z","title":"Kinectfusion: Real-time 3d reconstruction and interaction using a moving depth camera","venue":null,"work_id":null,"year":2011},"citing_paper":{"arxiv_id":"2606.04291","last_updated":"2026-06-02T23:41:52Z","snapshot_observed_at":"2026-08-12T18:56:09.302526Z","submitted_at":"2026-06-02T23:41:52Z","title":"A Cookbook of 3D Vision: Data, Learning Paradigms, and Application","version":1},"reference_index":61,"source":"pdf_text","source_observed_at":"2026-06-28T10:14:42.067337Z"},"links":{"citing_paper":"/paper/2606.04291"},"observation_digest":"sha256:6da8c47e4c23f30835d6b85293c291af5d3343df74667a00499439df91d678de","observation_id":"9ac1201f-64e5-46aa-93a0-a72fdb7af5e2","resolution":{"observed_at":"2026-06-28T10:14:42.067337Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-28T10:14:42.067337Z","title":"Rayzer: A self-supervised large view synthesis model, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2606.04291","last_updated":"2026-06-02T23:41:52Z","snapshot_observed_at":"2026-08-12T18:56:09.302526Z","submitted_at":"2026-06-02T23:41:52Z","title":"A Cookbook of 3D Vision: Data, Learning Paradigms, and Application","version":1},"reference_index":62,"source":"pdf_text","source_observed_at":"2026-06-28T10:14:42.067337Z"},"links":{"citing_paper":"/paper/2606.04291"},"observation_digest":"sha256:8a7b4a0eda19d888632290825c6248bfb63e764786ca09ded006a3db4ff095f4","observation_id":"63968f9d-dad4-457a-89e1-bee6184a4d0a","resolution":{"observed_at":"2026-06-28T10:14:42.067337Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-28T10:14:42.067337Z","title":"Megasynth: Scaling up 3d scene 13 reconstruction with synthesized data","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2606.04291","last_updated":"2026-06-02T23:41:52Z","snapshot_observed_at":"2026-08-12T18:56:09.302526Z","submitted_at":"2026-06-02T23:41:52Z","title":"A Cookbook of 3D Vision: Data, Learning Paradigms, and Application","version":1},"reference_index":63,"source":"pdf_text","source_observed_at":"2026-06-28T10:14:42.067337Z"},"links":{"citing_paper":"/paper/2606.04291"},"observation_digest":"sha256:30f4227233f021f5c4718942a5c26d440898a144ac58fc5d747f9cc68fd58dd3","observation_id":"4b7c7954-e93b-41fb-b4e9-437f63cd663c","resolution":{"observed_at":"2026-06-28T10:14:42.067337Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-28T10:14:42.067337Z","title":"Rellis-3d dataset: Data, benchmarks and analysis, 2020","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2606.04291","last_updated":"2026-06-02T23:41:52Z","snapshot_observed_at":"2026-08-12T18:56:09.302526Z","submitted_at":"2026-06-02T23:41:52Z","title":"A Cookbook of 3D Vision: Data, Learning Paradigms, and Application","version":1},"reference_index":64,"source":"pdf_text","source_observed_at":"2026-06-28T10:14:42.067337Z"},"links":{"citing_paper":"/paper/2606.04291"},"observation_digest":"sha256:fbb7f5907b05e16d1d732b204982109ddcd2594f5641d5f512e5d105cf9c3efd","observation_id":"4e09d29e-cf3f-4139-9b08-ecfac6ef5654","resolution":{"observed_at":"2026-06-28T10:14:42.067337Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-28T10:14:42.067337Z","title":"Tensoir: Tensorial inverse rendering, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2606.04291","last_updated":"2026-06-02T23:41:52Z","snapshot_observed_at":"2026-08-12T18:56:09.302526Z","submitted_at":"2026-06-02T23:41:52Z","title":"A Cookbook of 3D Vision: Data, Learning Paradigms, and Application","version":1},"reference_index":65,"source":"pdf_text","source_observed_at":"2026-06-28T10:14:42.067337Z"},"links":{"citing_paper":"/paper/2606.04291"},"observation_digest":"sha256:7b5dd97336d91ff5dad88f4a30b47f16568d18b930fec14a865948fd0400730d","observation_id":"ce83f580-373d-4293-b889-d3309f03e062","resolution":{"observed_at":"2026-06-28T10:14:42.067337Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-28T10:14:42.067337Z","title":"Neural 3d mesh renderer, 2017","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2606.04291","last_updated":"2026-06-02T23:41:52Z","snapshot_observed_at":"2026-08-12T18:56:09.302526Z","submitted_at":"2026-06-02T23:41:52Z","title":"A Cookbook of 3D Vision: Data, Learning Paradigms, and Application","version":1},"reference_index":66,"source":"pdf_text","source_observed_at":"2026-06-28T10:14:42.067337Z"},"links":{"citing_paper":"/paper/2606.04291"},"observation_digest":"sha256:42b330f5c1c6504a8cbd362c2f0d4aade552fb99b9ff2a70ad1928497a0b6740","observation_id":"c5ad0f6c-5e09-4b31-aff3-d425f1a235cf","resolution":{"observed_at":"2026-06-28T10:14:42.067337Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-28T10:14:42.067337Z","title":"Differentiable rendering: A survey, 2020","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2606.04291","last_updated":"2026-06-02T23:41:52Z","snapshot_observed_at":"2026-08-12T18:56:09.302526Z","submitted_at":"2026-06-02T23:41:52Z","title":"A Cookbook of 3D Vision: Data, Learning Paradigms, and Application","version":1},"reference_index":67,"source":"pdf_text","source_observed_at":"2026-06-28T10:14:42.067337Z"},"links":{"citing_paper":"/paper/2606.04291"},"observation_digest":"sha256:1358140d5e66010a5deb594e28604a2cef2bec916559b311a3c79f2487e15d8c","observation_id":"1b825d89-f66b-4fca-be69-72077b41baaa","resolution":{"observed_at":"2026-06-28T10:14:42.067337Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-28T10:14:42.067337Z","title":"Screened poisson surface reconstruction.ACM Trans","venue":null,"work_id":null,"year":2013},"citing_paper":{"arxiv_id":"2606.04291","last_updated":"2026-06-02T23:41:52Z","snapshot_observed_at":"2026-08-12T18:56:09.302526Z","submitted_at":"2026-06-02T23:41:52Z","title":"A Cookbook of 3D Vision: Data, Learning Paradigms, and Application","version":1},"reference_index":68,"source":"pdf_text","source_observed_at":"2026-06-28T10:14:42.067337Z"},"links":{"citing_paper":"/paper/2606.04291"},"observation_digest":"sha256:b364bb75df9dbbfc481c6e7e0c874b8745e95120c80fe2ceeceb3292f9943292","observation_id":"4cc85f9b-196e-418c-b4e7-e609be88cae1","resolution":{"observed_at":"2026-06-28T10:14:42.067337Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-28T10:14:42.067337Z","title":"Poisson surface reconstruction.Proceedings of the Fourth Eurographics Symposium on Geometry Processing, 7:61–70, 2006","venue":null,"work_id":null,"year":2006},"citing_paper":{"arxiv_id":"2606.04291","last_updated":"2026-06-02T23:41:52Z","snapshot_observed_at":"2026-08-12T18:56:09.302526Z","submitted_at":"2026-06-02T23:41:52Z","title":"A Cookbook of 3D Vision: Data, Learning Paradigms, and Application","version":1},"reference_index":69,"source":"pdf_text","source_observed_at":"2026-06-28T10:14:42.067337Z"},"links":{"citing_paper":"/paper/2606.04291"},"observation_digest":"sha256:48a6d7cd17d16a8872fc9046a6803d47aa36ec3492bb320070d241a79ae4bd01","observation_id":"fe7e7e45-145e-43af-9826-e9425bb4f7f4","resolution":{"observed_at":"2026-06-28T10:14:42.067337Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-28T10:14:42.067337Z","title":"Posenet: A convolutional network for real-time 6-dof camera relocalization","venue":null,"work_id":null,"year":2015},"citing_paper":{"arxiv_id":"2606.04291","last_updated":"2026-06-02T23:41:52Z","snapshot_observed_at":"2026-08-12T18:56:09.302526Z","submitted_at":"2026-06-02T23:41:52Z","title":"A Cookbook of 3D Vision: Data, Learning Paradigms, and Application","version":1},"reference_index":70,"source":"pdf_text","source_observed_at":"2026-06-28T10:14:42.067337Z"},"links":{"citing_paper":"/paper/2606.04291"},"observation_digest":"sha256:473a64b11532bd0ed4967e74d0172ab49c657ebb3618362415f7a013a2f14492","observation_id":"add533ff-9d2c-41f8-8d94-486cd546110a","resolution":{"observed_at":"2026-06-28T10:14:42.067337Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-28T10:14:42.067337Z","title":"3d gaussian splatting for real-time radiance field rendering, 2023","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2606.04291","last_updated":"2026-06-02T23:41:52Z","snapshot_observed_at":"2026-08-12T18:56:09.302526Z","submitted_at":"2026-06-02T23:41:52Z","title":"A Cookbook of 3D Vision: Data, Learning Paradigms, and Application","version":1},"reference_index":71,"source":"pdf_text","source_observed_at":"2026-06-28T10:14:42.067337Z"},"links":{"citing_paper":"/paper/2606.04291"},"observation_digest":"sha256:f4c4504d75a04e19d1039840196720be532e90a685105550ebde1cb2fd38efd2","observation_id":"0d41940a-0189-4950-8acc-38f2f22ab42a","resolution":{"observed_at":"2026-06-28T10:14:42.067337Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-28T10:14:42.067337Z","title":"Egohumans: An egocentric 3d multi-human benchmark, 2023","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2606.04291","last_updated":"2026-06-02T23:41:52Z","snapshot_observed_at":"2026-08-12T18:56:09.302526Z","submitted_at":"2026-06-02T23:41:52Z","title":"A Cookbook of 3D Vision: Data, Learning Paradigms, and Application","version":1},"reference_index":72,"source":"pdf_text","source_observed_at":"2026-06-28T10:14:42.067337Z"},"links":{"citing_paper":"/paper/2606.04291"},"observation_digest":"sha256:80aea210b07c6aee6e236c227077c121aa50c63bc00b1bb1e007b913530d95f8","observation_id":"c32c9453-ea64-45c5-995c-bc4aab5b0762","resolution":{"observed_at":"2026-06-28T10:14:42.067337Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-28T10:14:42.067337Z","title":"Parallel tracking and mapping for small ar workspaces","venue":null,"work_id":null,"year":2007},"citing_paper":{"arxiv_id":"2606.04291","last_updated":"2026-06-02T23:41:52Z","snapshot_observed_at":"2026-08-12T18:56:09.302526Z","submitted_at":"2026-06-02T23:41:52Z","title":"A Cookbook of 3D Vision: Data, Learning Paradigms, and Application","version":1},"reference_index":73,"source":"pdf_text","source_observed_at":"2026-06-28T10:14:42.067337Z"},"links":{"citing_paper":"/paper/2606.04291"},"observation_digest":"sha256:837224eb4210ec2f127980f39814f432b150aaede2421e4be4b10a81e3eef68a","observation_id":"036dc16a-a5b7-445d-883c-2999a3837c3b","resolution":{"observed_at":"2026-06-28T10:14:42.067337Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-28T10:14:42.067337Z","title":"Abc: A big cad model dataset for geometric deep learning","venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2606.04291","last_updated":"2026-06-02T23:41:52Z","snapshot_observed_at":"2026-08-12T18:56:09.302526Z","submitted_at":"2026-06-02T23:41:52Z","title":"A Cookbook of 3D Vision: Data, Learning Paradigms, and Application","version":1},"reference_index":74,"source":"pdf_text","source_observed_at":"2026-06-28T10:14:42.067337Z"},"links":{"citing_paper":"/paper/2606.04291"},"observation_digest":"sha256:1ccb4376f331cf91d3bfce8da0df46f4d552ecb79b681ea34c29ece540f6edaf","observation_id":"bc956d20-7c2d-48c1-868b-a2be91bad3bb","resolution":{"observed_at":"2026-06-28T10:14:42.067337Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-28T10:14:42.067337Z","title":"Oneformer3d: One transformer for unified point cloud segmentation","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2606.04291","last_updated":"2026-06-02T23:41:52Z","snapshot_observed_at":"2026-08-12T18:56:09.302526Z","submitted_at":"2026-06-02T23:41:52Z","title":"A Cookbook of 3D Vision: Data, Learning Paradigms, and Application","version":1},"reference_index":75,"source":"pdf_text","source_observed_at":"2026-06-28T10:14:42.067337Z"},"links":{"citing_paper":"/paper/2606.04291"},"observation_digest":"sha256:b7307e325a77a81a234469f485a7e244e6a676e39a5e03746e01531d253e1ba0","observation_id":"496244cf-cb1a-4a24-834e-d0535e661ff9","resolution":{"observed_at":"2026-06-28T10:14:42.067337Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-28T10:14:42.067337Z","title":"Epipolar geometry improves video generation models, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2606.04291","last_updated":"2026-06-02T23:41:52Z","snapshot_observed_at":"2026-08-12T18:56:09.302526Z","submitted_at":"2026-06-02T23:41:52Z","title":"A Cookbook of 3D Vision: Data, Learning Paradigms, and Application","version":1},"reference_index":76,"source":"pdf_text","source_observed_at":"2026-06-28T10:14:42.067337Z"},"links":{"citing_paper":"/paper/2606.04291"},"observation_digest":"sha256:e71c8ac449a36c318a4c4056ff0a7d8953b61457691749499c3dbdae8509e18e","observation_id":"d11d8832-d4b4-4d9d-b823-508fd81f45af","resolution":{"observed_at":"2026-06-28T10:14:42.067337Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-28T10:14:42.067337Z","title":"3d vision with transformers: A survey, 2022","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2606.04291","last_updated":"2026-06-02T23:41:52Z","snapshot_observed_at":"2026-08-12T18:56:09.302526Z","submitted_at":"2026-06-02T23:41:52Z","title":"A Cookbook of 3D Vision: Data, Learning Paradigms, and Application","version":1},"reference_index":77,"source":"pdf_text","source_observed_at":"2026-06-28T10:14:42.067337Z"},"links":{"citing_paper":"/paper/2606.04291"},"observation_digest":"sha256:ac867ea862d36970cc9dd98aecc8e1fdc95bd002ba54bf6880d6ec590aa4c1b3","observation_id":"4118b8e8-cc6e-4b49-b22b-f1533d4bbe1b","resolution":{"observed_at":"2026-06-28T10:14:42.067337Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-28T10:14:42.067337Z","title":"Stratified transformer for 3d point cloud segmentation","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2606.04291","last_updated":"2026-06-02T23:41:52Z","snapshot_observed_at":"2026-08-12T18:56:09.302526Z","submitted_at":"2026-06-02T23:41:52Z","title":"A Cookbook of 3D Vision: Data, Learning Paradigms, and Application","version":1},"reference_index":78,"source":"pdf_text","source_observed_at":"2026-06-28T10:14:42.067337Z"},"links":{"citing_paper":"/paper/2606.04291"},"observation_digest":"sha256:a2e5931717d27f46a596f8441dca12c2f7395cbbe39f160c53e5ae1e669ffdde","observation_id":"f257e9b8-01c4-4e93-9459-704910bdcba6","resolution":{"observed_at":"2026-06-28T10:14:42.067337Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-28T10:14:42.067337Z","title":"Advances in 3d generation: A survey, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2606.04291","last_updated":"2026-06-02T23:41:52Z","snapshot_observed_at":"2026-08-12T18:56:09.302526Z","submitted_at":"2026-06-02T23:41:52Z","title":"A Cookbook of 3D Vision: Data, Learning Paradigms, and Application","version":1},"reference_index":79,"source":"pdf_text","source_observed_at":"2026-06-28T10:14:42.067337Z"},"links":{"citing_paper":"/paper/2606.04291"},"observation_digest":"sha256:144b59d86485441eba55b584d27c34e18a66e9c4af569635cd259a0adb6ba05f","observation_id":"34507612-0558-4204-b4a1-29d507f2c5b4","resolution":{"observed_at":"2026-06-28T10:14:42.067337Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-28T10:14:42.067337Z","title":"Megadepth: Learning single-view depth prediction from internet photos","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2606.04291","last_updated":"2026-06-02T23:41:52Z","snapshot_observed_at":"2026-08-12T18:56:09.302526Z","submitted_at":"2026-06-02T23:41:52Z","title":"A Cookbook of 3D Vision: Data, Learning Paradigms, and Application","version":1},"reference_index":80,"source":"pdf_text","source_observed_at":"2026-06-28T10:14:42.067337Z"},"links":{"citing_paper":"/paper/2606.04291"},"observation_digest":"sha256:107e0502db3d56ec96d62e4df256458c9c41ad9eacf13358e6bcce3dcc7b4f85","observation_id":"f7a6adc6-b43f-4906-a85e-f55622e05e30","resolution":{"observed_at":"2026-06-28T10:14:42.067337Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-28T10:14:42.067337Z","title":"Pointmamba: A simple state space model for point cloud analysis, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2606.04291","last_updated":"2026-06-02T23:41:52Z","snapshot_observed_at":"2026-08-12T18:56:09.302526Z","submitted_at":"2026-06-02T23:41:52Z","title":"A Cookbook of 3D Vision: Data, Learning Paradigms, and Application","version":1},"reference_index":81,"source":"pdf_text","source_observed_at":"2026-06-28T10:14:42.067337Z"},"links":{"citing_paper":"/paper/2606.04291"},"observation_digest":"sha256:ddd88fc9724f2730fb128206f55f5336aca7593072ad6deff7f7655ef175a094","observation_id":"7c3d6598-0571-4a19-bcae-74944e2a5be8","resolution":{"observed_at":"2026-06-28T10:14:42.067337Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-28T10:14:42.067337Z","title":"Magic3d: High-resolution text-to-3d content creation","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2606.04291","last_updated":"2026-06-02T23:41:52Z","snapshot_observed_at":"2026-08-12T18:56:09.302526Z","submitted_at":"2026-06-02T23:41:52Z","title":"A Cookbook of 3D Vision: Data, Learning Paradigms, and Application","version":1},"reference_index":82,"source":"pdf_text","source_observed_at":"2026-06-28T10:14:42.067337Z"},"links":{"citing_paper":"/paper/2606.04291"},"observation_digest":"sha256:7811b912418d06e6198a91a168ab600a32eb26ab27410c6612ffddb985cdf9ba","observation_id":"08e876fa-0b39-4d92-a70b-e451b24c4baa","resolution":{"observed_at":"2026-06-28T10:14:42.067337Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2511.10647","last_updated":"2025-11-13T18:59:53Z","snapshot_observed_at":"2026-07-06T22:35:46.018050Z","submitted_at":"2025-11-13T18:59:53Z","title":"Depth Anything 3: Recovering the Visual Space from Any Views","version":1},"cited_work":{"arxiv_id":"2511.10647","doi":"10.48550/arxiv.2511.10647","metadata_source":"pith","pith_arxiv_id":"2511.10647","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Depth Anything 3: Recovering the Visual Space from Any Views","venue":"cs.CV","work_id":"0a54b500-1e9d-46c2-85eb-8e16cbac8461","year":2025},"citing_paper":{"arxiv_id":"2606.04291","last_updated":"2026-06-02T23:41:52Z","snapshot_observed_at":"2026-08-12T18:56:09.302526Z","submitted_at":"2026-06-02T23:41:52Z","title":"A Cookbook of 3D Vision: Data, Learning Paradigms, and Application","version":1},"reference_index":83,"source":"pdf_text","source_observed_at":"2026-06-28T10:14:42.067337Z"},"links":{"cited_paper":"/paper/2511.10647","citing_paper":"/paper/2606.04291"},"observation_digest":"sha256:01990b9c32329a8c1d2141a6eeec1fbf926bdf9cde32abe67126bfee35e32d53","observation_id":"11efcffc-f79d-496b-b7a6-5d56f2751bac","resolution":{"observed_at":"2026-07-02T03:16:33.524238Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-28T10:14:42.067337Z","title":"Dl3dv-10k: A large-scale scene dataset for deep learning-based 3d vision, 2023","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2606.04291","last_updated":"2026-06-02T23:41:52Z","snapshot_observed_at":"2026-08-12T18:56:09.302526Z","submitted_at":"2026-06-02T23:41:52Z","title":"A Cookbook of 3D Vision: Data, Learning Paradigms, and Application","version":1},"reference_index":84,"source":"pdf_text","source_observed_at":"2026-06-28T10:14:42.067337Z"},"links":{"citing_paper":"/paper/2606.04291"},"observation_digest":"sha256:f7d8b1f4b66322e2f1d129418a797cf140fb9e9ed7645a2c514f64ea6732ea5d","observation_id":"d4472993-47e9-48fe-ad88-4ee302efbb5b","resolution":{"observed_at":"2026-06-28T10:14:42.067337Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-28T10:14:42.067337Z","title":"Point mamba: A novel point cloud backbone based on state space model with octree-based ordering strategy, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2606.04291","last_updated":"2026-06-02T23:41:52Z","snapshot_observed_at":"2026-08-12T18:56:09.302526Z","submitted_at":"2026-06-02T23:41:52Z","title":"A Cookbook of 3D Vision: Data, Learning Paradigms, and Application","version":1},"reference_index":85,"source":"pdf_text","source_observed_at":"2026-06-28T10:14:42.067337Z"},"links":{"citing_paper":"/paper/2606.04291"},"observation_digest":"sha256:8a47b31ee3d6e5d224b4065ce1c1e1e08e7f5e7687de17d71ff3fbdaf1160b56","observation_id":"8b70348f-42db-4951-ae27-0951c0a6903c","resolution":{"observed_at":"2026-06-28T10:14:42.067337Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-28T10:14:42.067337Z","title":"Neural sparse voxel fields","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2606.04291","last_updated":"2026-06-02T23:41:52Z","snapshot_observed_at":"2026-08-12T18:56:09.302526Z","submitted_at":"2026-06-02T23:41:52Z","title":"A Cookbook of 3D Vision: Data, Learning Paradigms, and Application","version":1},"reference_index":86,"source":"pdf_text","source_observed_at":"2026-06-28T10:14:42.067337Z"},"links":{"citing_paper":"/paper/2606.04291"},"observation_digest":"sha256:89afb1787b68931e6021407c7d12a1752bc7a2984d09ed95ed382a10498074bf","observation_id":"f09a2f78-d635-4a01-b9ea-c8fe9ccaf4e0","resolution":{"observed_at":"2026-06-28T10:14:42.067337Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-28T10:14:42.067337Z","title":"Zero-1-to-3: Zero-shot one image to 3d object","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2606.04291","last_updated":"2026-06-02T23:41:52Z","snapshot_observed_at":"2026-08-12T18:56:09.302526Z","submitted_at":"2026-06-02T23:41:52Z","title":"A Cookbook of 3D Vision: Data, Learning Paradigms, and Application","version":1},"reference_index":87,"source":"pdf_text","source_observed_at":"2026-06-28T10:14:42.067337Z"},"links":{"citing_paper":"/paper/2606.04291"},"observation_digest":"sha256:13288c213fe27f120ddd0e167f6764ef8d809ce39aa8393df77d9e6bc7d2196d","observation_id":"67fad8a2-909a-4eb7-8550-4006e02e6219","resolution":{"observed_at":"2026-06-28T10:14:42.067337Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-28T10:14:42.067337Z","title":"Soft rasterizer: A differentiable renderer for image-based 3d reasoning, 2019","venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2606.04291","last_updated":"2026-06-02T23:41:52Z","snapshot_observed_at":"2026-08-12T18:56:09.302526Z","submitted_at":"2026-06-02T23:41:52Z","title":"A Cookbook of 3D Vision: Data, Learning Paradigms, and Application","version":1},"reference_index":88,"source":"pdf_text","source_observed_at":"2026-06-28T10:14:42.067337Z"},"links":{"citing_paper":"/paper/2606.04291"},"observation_digest":"sha256:f1641923e06db76cecf35ce4d9c11ac9d57ff4a33a9aed54c23c7f3ec4aee4db","observation_id":"9b79142d-b131-4cfb-b165-1acdc7273c5c","resolution":{"observed_at":"2026-06-28T10:14:42.067337Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-28T10:14:42.067337Z","title":"Loper and Michael J","venue":null,"work_id":null,"year":2014},"citing_paper":{"arxiv_id":"2606.04291","last_updated":"2026-06-02T23:41:52Z","snapshot_observed_at":"2026-08-12T18:56:09.302526Z","submitted_at":"2026-06-02T23:41:52Z","title":"A Cookbook of 3D Vision: Data, Learning Paradigms, and Application","version":1},"reference_index":89,"source":"pdf_text","source_observed_at":"2026-06-28T10:14:42.067337Z"},"links":{"citing_paper":"/paper/2606.04291"},"observation_digest":"sha256:1407958c310695e99d056a16a1005d9ad03405961f43460641fcce7f7f64ea77","observation_id":"e846bf5a-7994-4031-b0ba-93ff3ee7d4a3","resolution":{"observed_at":"2026-06-28T10:14:42.067337Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-28T10:14:42.067337Z","title":"Comport, Kefan Chen, and Srinath Sridhar","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2606.04291","last_updated":"2026-06-02T23:41:52Z","snapshot_observed_at":"2026-08-12T18:56:09.302526Z","submitted_at":"2026-06-02T23:41:52Z","title":"A Cookbook of 3D Vision: Data, Learning Paradigms, and Application","version":1},"reference_index":90,"source":"pdf_text","source_observed_at":"2026-06-28T10:14:42.067337Z"},"links":{"citing_paper":"/paper/2606.04291"},"observation_digest":"sha256:76cc468dfe0ef10e476899b56fbbf2e023bd6a575860283436f323519657179b","observation_id":"eb194461-b85c-419e-ad10-93fe1f4eee02","resolution":{"observed_at":"2026-06-28T10:14:42.067337Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-28T10:14:42.067337Z","title":"3dctn: 3d convolution-transformer network for point cloud classification.IEEE Transactions on Intelligent Transportation Systems, 23(12):24854–24865, 2022","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2606.04291","last_updated":"2026-06-02T23:41:52Z","snapshot_observed_at":"2026-08-12T18:56:09.302526Z","submitted_at":"2026-06-02T23:41:52Z","title":"A Cookbook of 3D Vision: Data, Learning Paradigms, and Application","version":1},"reference_index":91,"source":"pdf_text","source_observed_at":"2026-06-28T10:14:42.067337Z"},"links":{"citing_paper":"/paper/2606.04291"},"observation_digest":"sha256:4f1cf2f6e3e7c8b3603a52e3150f50cb6062bf8097b7b56c9b4bdbbfb1bc589d","observation_id":"33c83da5-a1ba-4f48-8fca-bda6a0e0978e","resolution":{"observed_at":"2026-06-28T10:14:42.067337Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-28T10:14:42.067337Z","title":"Transformers in 3d point clouds: A survey, 2022","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2606.04291","last_updated":"2026-06-02T23:41:52Z","snapshot_observed_at":"2026-08-12T18:56:09.302526Z","submitted_at":"2026-06-02T23:41:52Z","title":"A Cookbook of 3D Vision: Data, Learning Paradigms, and Application","version":1},"reference_index":92,"source":"pdf_text","source_observed_at":"2026-06-28T10:14:42.067337Z"},"links":{"citing_paper":"/paper/2606.04291"},"observation_digest":"sha256:64bf615620b6b7b2a8298a5498c95786f8b819e41266832b5814eb1c4453f96a","observation_id":"194d7946-07c2-4686-a952-bb99a0b1bffe","resolution":{"observed_at":"2026-06-28T10:14:42.067337Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-28T10:14:42.067337Z","title":"Dynamic 3d gaussians: Tracking by persistent dynamic view synthesis, 2023","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2606.04291","last_updated":"2026-06-02T23:41:52Z","snapshot_observed_at":"2026-08-12T18:56:09.302526Z","submitted_at":"2026-06-02T23:41:52Z","title":"A Cookbook of 3D Vision: Data, Learning Paradigms, and Application","version":1},"reference_index":93,"source":"pdf_text","source_observed_at":"2026-06-28T10:14:42.067337Z"},"links":{"citing_paper":"/paper/2606.04291"},"observation_digest":"sha256:9dcb7e3d6e9cc9638070873f49663fc2abea7e44e4926bcd22eb399d2a186d96","observation_id":"2995e39e-66b1-4b49-a26b-63b594e39203","resolution":{"observed_at":"2026-06-28T10:14:42.067337Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-28T10:14:42.067337Z","title":"Ojea, and Ken Goldberg","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2606.04291","last_updated":"2026-06-02T23:41:52Z","snapshot_observed_at":"2026-08-12T18:56:09.302526Z","submitted_at":"2026-06-02T23:41:52Z","title":"A Cookbook of 3D Vision: Data, Learning Paradigms, and Application","version":1},"reference_index":94,"source":"pdf_text","source_observed_at":"2026-06-28T10:14:42.067337Z"},"links":{"citing_paper":"/paper/2606.04291"},"observation_digest":"sha256:dba610df84a3e436f3f327f06fa88e091bf365b0cf848e76cf751810a3216925","observation_id":"614f160e-353d-445b-bd52-b7e1d83714ff","resolution":{"observed_at":"2026-06-28T10:14:42.067337Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-28T10:14:42.067337Z","title":"Computer Science Press, Rockville, MD, 1988","venue":null,"work_id":null,"year":1988},"citing_paper":{"arxiv_id":"2606.04291","last_updated":"2026-06-02T23:41:52Z","snapshot_observed_at":"2026-08-12T18:56:09.302526Z","submitted_at":"2026-06-02T23:41:52Z","title":"A Cookbook of 3D Vision: Data, Learning Paradigms, and Application","version":1},"reference_index":95,"source":"pdf_text","source_observed_at":"2026-06-28T10:14:42.067337Z"},"links":{"citing_paper":"/paper/2606.04291"},"observation_digest":"sha256:48054eb6f5ac95692c5bf005e1996188e01d96593bf88ee2041497881fbb69de","observation_id":"0c04ceb4-00ae-4ee6-8088-d6ef01e0c10a","resolution":{"observed_at":"2026-06-28T10:14:42.067337Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-28T10:14:42.067337Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2606.04291","last_updated":"2026-06-02T23:41:52Z","snapshot_observed_at":"2026-08-12T18:56:09.302526Z","submitted_at":"2026-06-02T23:41:52Z","title":"A Cookbook of 3D Vision: Data, Learning Paradigms, and Application","version":1},"reference_index":96,"source":"pdf_text","source_observed_at":"2026-06-28T10:14:42.067337Z"},"links":{"citing_paper":"/paper/2606.04291"},"observation_digest":"sha256:b14db3c1ad60448bb4edaca02b65aa1e739969db5b91098950082b8b3fa143f4","observation_id":"f2f5145c-75a7-4515-b1bb-3df76a5dd72b","resolution":{"observed_at":"2026-06-28T10:14:42.067337Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-28T10:14:42.067337Z","title":"Voxnet: A 3d convolutional neural network for real-time object recognition","venue":null,"work_id":null,"year":2015},"citing_paper":{"arxiv_id":"2606.04291","last_updated":"2026-06-02T23:41:52Z","snapshot_observed_at":"2026-08-12T18:56:09.302526Z","submitted_at":"2026-06-02T23:41:52Z","title":"A Cookbook of 3D Vision: Data, Learning Paradigms, and Application","version":1},"reference_index":97,"source":"pdf_text","source_observed_at":"2026-06-28T10:14:42.067337Z"},"links":{"citing_paper":"/paper/2606.04291"},"observation_digest":"sha256:a4087d1c71eaa38351962182d23f69e67872a643517f7ef3ab6f10d90390359b","observation_id":"d68e3996-df33-4fab-9f7c-2b82b944ce24","resolution":{"observed_at":"2026-06-28T10:14:42.067337Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-28T10:14:42.067337Z","title":"Occupancy networks: Learning 3d reconstruction in function space","venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2606.04291","last_updated":"2026-06-02T23:41:52Z","snapshot_observed_at":"2026-08-12T18:56:09.302526Z","submitted_at":"2026-06-02T23:41:52Z","title":"A Cookbook of 3D Vision: Data, Learning Paradigms, and Application","version":1},"reference_index":98,"source":"pdf_text","source_observed_at":"2026-06-28T10:14:42.067337Z"},"links":{"citing_paper":"/paper/2606.04291"},"observation_digest":"sha256:71cef43ab31736f7926e0b89c01fa3799438c91fe3936c819cb1104ad871e1ad","observation_id":"e26cd02f-e7ed-427d-b436-33caca84782b","resolution":{"observed_at":"2026-06-28T10:14:42.067337Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-28T10:14:42.067337Z","title":"Latent-nerf for shape-guided generation of 3d shapes and textures","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2606.04291","last_updated":"2026-06-02T23:41:52Z","snapshot_observed_at":"2026-08-12T18:56:09.302526Z","submitted_at":"2026-06-02T23:41:52Z","title":"A Cookbook of 3D Vision: Data, Learning Paradigms, and Application","version":1},"reference_index":99,"source":"pdf_text","source_observed_at":"2026-06-28T10:14:42.067337Z"},"links":{"citing_paper":"/paper/2606.04291"},"observation_digest":"sha256:d6c66ea3336be6f606932f3f65597d4eb6a6e07a14928302a8d4f724aebefffc","observation_id":"e3d1dab1-dd5c-4589-9bb6-7b5ade7ccf8e","resolution":{"observed_at":"2026-06-28T10:14:42.067337Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-28T10:14:42.067337Z","title":"Srinivasan, Matthew Tancik, Jonathan T","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2606.04291","last_updated":"2026-06-02T23:41:52Z","snapshot_observed_at":"2026-08-12T18:56:09.302526Z","submitted_at":"2026-06-02T23:41:52Z","title":"A Cookbook of 3D Vision: Data, Learning Paradigms, and Application","version":1},"reference_index":100,"source":"pdf_text","source_observed_at":"2026-06-28T10:14:42.067337Z"},"links":{"citing_paper":"/paper/2606.04291"},"observation_digest":"sha256:e44091f255cfa9e7dba152cc471e4044f5640a60d8b79dd6c08ca7f93026d124","observation_id":"ae8d4cea-c61b-4dc3-a5c0-2164967291b0","resolution":{"observed_at":"2026-06-28T10:14:42.067337Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"paper":{"arxiv_id":"2606.04291","last_updated":"2026-06-02T23:41:52Z","latest_version":1,"primary_category":"cs.CV","snapshot_observed_at":"2026-08-12T18:56:09.302526Z","submitted_at":"2026-06-02T23:41:52Z","title":"A Cookbook of 3D Vision: Data, Learning Paradigms, and Application"},"reference_resolution":{"displayed":100,"state_counts":{"malformed_identifier":0,"metadata_mismatch":1,"parse_uncertain":0,"unresolved":94,"verified_exact":5,"verified_fuzzy":0},"total_outbound_references":181},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"thesis":"As of 13 August 2026, this Paper Citation Record lists 100 of 181 outbound references and 0 inbound Pith citation observations for arXiv:2606.04291."}