{"as_of":"2026-08-09T18:48:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:5dbf6f6fe73c2dc7f7e69b35a6c5525155a4e36a3e98b18ebf811fec2fec3542","coverage":[{"denominator":72,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":72,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-06T18:10:16.872826Z","state":"measured"},{"denominator":72,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":72,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-09T06:31:02.800959+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2507.09102/citation-record","integrity":"/paper/2507.09102/integrity","json":"/paper/2507.09102/citation-record.json","paper":"/paper/2507.09102"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T18:11:17.611792Z","title":"Crosspoint: Self-supervised cross-modal contrastive learning for 3d point cloud understanding","venue":null,"work_id":"ce1afb6e-3f52-4ad8-8db4-28cc5e4b869a","year":2022},"citing_paper":{"arxiv_id":"2507.09102","last_updated":"2025-07-12T01:20:07Z","snapshot_observed_at":"2026-08-06T18:02:05.774630Z","submitted_at":"2025-07-12T01:20:07Z","title":"Harnessing Text-to-Image Diffusion Models for Point Cloud Self-Supervised Learning","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-06T18:10:12.847511Z"},"links":{"citing_paper":"/paper/2507.09102"},"observation_digest":"sha256:c2829f5023a82c754b60288a01e0b07356c71b0d8062900d8fed7ff603ac72a6","observation_id":"2505c0ab-56a1-44a9-9cf8-66e14b75107a","resolution":{"observed_at":"2026-08-06T18:11:17.653408Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T18:10:12.878546Z","title":"Se- mantickitti: A dataset for semantic scene understanding of lidar sequences","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2507.09102","last_updated":"2025-07-12T01:20:07Z","snapshot_observed_at":"2026-08-06T18:02:05.774630Z","submitted_at":"2025-07-12T01:20:07Z","title":"Harnessing Text-to-Image Diffusion Models for Point Cloud Self-Supervised Learning","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-06T18:10:12.878546Z"},"links":{"citing_paper":"/paper/2507.09102"},"observation_digest":"sha256:952864ed30369d4cbe6af0ea176865182752766b0d2a5c0bd957bfd0fded5d35","observation_id":"2a8300f4-d514-4507-9180-a7dc13b52252","resolution":{"observed_at":"2026-08-06T18:10:12.878546Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2311.15127","last_updated":"2023-11-25T22:28:38Z","snapshot_observed_at":"2026-08-07T21:47:08.589400Z","submitted_at":"2023-11-25T22:28:38Z","title":"Stable Video Diffusion: Scaling Latent Video Diffusion Models to Large Datasets","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2311.15127","snapshot_observed_at":"2026-08-06T18:10:12.939433Z","title":"Stable video diffusion: Scaling latent video diffusion models to large datasets.arXiv preprint arXiv:2311.15127, 2023","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2507.09102","last_updated":"2025-07-12T01:20:07Z","snapshot_observed_at":"2026-08-06T18:02:05.774630Z","submitted_at":"2025-07-12T01:20:07Z","title":"Harnessing Text-to-Image Diffusion Models for Point Cloud Self-Supervised Learning","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-06T18:10:12.939433Z"},"links":{"cited_paper":"/paper/2311.15127","citing_paper":"/paper/2507.09102"},"observation_digest":"sha256:5d1ba31b7688edef1895d63ab3a73fca63b76ac237145075dc55d3c91574722e","observation_id":"6b22e63e-bc59-4d61-9995-1cd2f7698a3c","resolution":{"observed_at":"2026-08-06T18:10:12.939433Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T18:10:13.023196Z","title":"Lan- guage models are few-shot learners.Advances in neural in- formation processing systems, 33:1877–1901, 2020","venue":null,"work_id":null,"year":1901},"citing_paper":{"arxiv_id":"2507.09102","last_updated":"2025-07-12T01:20:07Z","snapshot_observed_at":"2026-08-06T18:02:05.774630Z","submitted_at":"2025-07-12T01:20:07Z","title":"Harnessing Text-to-Image Diffusion Models for Point Cloud Self-Supervised Learning","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-06T18:10:13.023196Z"},"links":{"citing_paper":"/paper/2507.09102"},"observation_digest":"sha256:898b21b80190ff209e95bb5d8f8fa5aa8faa52b2ccbd6f3b40cac675d1d3d714","observation_id":"ed326cb4-a057-44af-9c5a-e48140650b0f","resolution":{"observed_at":"2026-08-06T18:10:13.023196Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T18:11:17.513128Z","title":"Emerg- ing properties in self-supervised vision transformers","venue":null,"work_id":"d54274d8-fae1-47f3-9431-4bdf96f50cdd","year":2021},"citing_paper":{"arxiv_id":"2507.09102","last_updated":"2025-07-12T01:20:07Z","snapshot_observed_at":"2026-08-06T18:02:05.774630Z","submitted_at":"2025-07-12T01:20:07Z","title":"Harnessing Text-to-Image Diffusion Models for Point Cloud Self-Supervised Learning","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-06T18:10:13.073706Z"},"links":{"citing_paper":"/paper/2507.09102"},"observation_digest":"sha256:9a8cd124295567978421880081599295964ae048a66480d15ff8f548f8d8261f","observation_id":"b40ca3d3-94e6-4744-a5f1-e977ba6c9c24","resolution":{"observed_at":"2026-08-06T18:11:17.540779Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1512.03012","last_updated":"2015-12-09T19:42:48Z","snapshot_observed_at":"2026-08-07T11:28:03.211074Z","submitted_at":"2015-12-09T19:42:48Z","title":"ShapeNet: An Information-Rich 3D Model Repository","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1512.03012","snapshot_observed_at":"2026-08-06T18:10:13.105370Z","title":"Shapenet: An information-rich 3d model repository.arXiv preprint arXiv:1512.03012, 2015","venue":null,"work_id":null,"year":2015},"citing_paper":{"arxiv_id":"2507.09102","last_updated":"2025-07-12T01:20:07Z","snapshot_observed_at":"2026-08-06T18:02:05.774630Z","submitted_at":"2025-07-12T01:20:07Z","title":"Harnessing Text-to-Image Diffusion Models for Point Cloud Self-Supervised Learning","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-06T18:10:13.105370Z"},"links":{"cited_paper":"/paper/1512.03012","citing_paper":"/paper/2507.09102"},"observation_digest":"sha256:e8358511224745bcc8409a5463c081d29345d8e724b13ece52f64d3cb7dcd2f8","observation_id":"4c73ecaa-2eac-4521-b79b-e84cc140257e","resolution":{"observed_at":"2026-08-06T18:10:13.105370Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T18:11:17.383461Z","title":"Pimae: Point cloud and image interactive masked autoencoders for 3d object detection","venue":null,"work_id":"3dd664ac-5fd6-4163-8a39-c88383f0ccf4","year":2023},"citing_paper":{"arxiv_id":"2507.09102","last_updated":"2025-07-12T01:20:07Z","snapshot_observed_at":"2026-08-06T18:02:05.774630Z","submitted_at":"2025-07-12T01:20:07Z","title":"Harnessing Text-to-Image Diffusion Models for Point Cloud Self-Supervised Learning","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-06T18:10:13.140901Z"},"links":{"citing_paper":"/paper/2507.09102"},"observation_digest":"sha256:5b3c18455f63656535e22b37c8258a719a7d63e34b5978dc5f48976c0e35f138","observation_id":"3835781d-8bb6-4978-8134-15712d92b154","resolution":{"observed_at":"2026-08-06T18:11:17.427683Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T18:10:13.200061Z","title":"Videocrafter1: Open diffusion models for high-quality video generation, 2023","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2507.09102","last_updated":"2025-07-12T01:20:07Z","snapshot_observed_at":"2026-08-06T18:02:05.774630Z","submitted_at":"2025-07-12T01:20:07Z","title":"Harnessing Text-to-Image Diffusion Models for Point Cloud Self-Supervised Learning","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-06T18:10:13.200061Z"},"links":{"citing_paper":"/paper/2507.09102"},"observation_digest":"sha256:6662a1e31e654886cef3554f0fc683a52440f237b68d2a9df58afade29c67844","observation_id":"aff5a1ba-d889-4958-b229-96c4d307af1e","resolution":{"observed_at":"2026-08-06T18:10:13.200061Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T18:11:17.223724Z","title":"A simple framework for contrastive learning of visual representations","venue":null,"work_id":"b9e08264-7bef-40a6-9b69-ab55e8b28f71","year":2020},"citing_paper":{"arxiv_id":"2507.09102","last_updated":"2025-07-12T01:20:07Z","snapshot_observed_at":"2026-08-06T18:02:05.774630Z","submitted_at":"2025-07-12T01:20:07Z","title":"Harnessing Text-to-Image Diffusion Models for Point Cloud Self-Supervised Learning","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-06T18:10:13.260591Z"},"links":{"citing_paper":"/paper/2507.09102"},"observation_digest":"sha256:02e0dc1603a9cbbd4eaed4edba92a4d3f7dbcfd660c9a818bd87e53e5267a579","observation_id":"e9e74191-8316-4955-982b-59e0572697f8","resolution":{"observed_at":"2026-08-06T18:11:17.275699Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T18:11:17.152878Z","title":"Pointmixup: Augmentation for point clouds","venue":null,"work_id":"268866d1-d5fe-4483-96e7-214fdb24ea81","year":2020},"citing_paper":{"arxiv_id":"2507.09102","last_updated":"2025-07-12T01:20:07Z","snapshot_observed_at":"2026-08-06T18:02:05.774630Z","submitted_at":"2025-07-12T01:20:07Z","title":"Harnessing Text-to-Image Diffusion Models for Point Cloud Self-Supervised Learning","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-06T18:10:13.296831Z"},"links":{"citing_paper":"/paper/2507.09102"},"observation_digest":"sha256:4ae61bfb116e21e3e5b907dba4f7ec7e42bd273096ef7368eb99edf472aa0999","observation_id":"1f24c81b-2196-4607-9c39-e7ef2179976e","resolution":{"observed_at":"2026-08-06T18:11:17.163200Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T18:11:17.074018Z","title":"Text-to-image diffusion mod- els are zero shot classifiers.Advances in Neural Information Processing Systems, 36, 2024","venue":null,"work_id":"03a9ed97-bd85-4d6b-9295-029c35177681","year":2024},"citing_paper":{"arxiv_id":"2507.09102","last_updated":"2025-07-12T01:20:07Z","snapshot_observed_at":"2026-08-06T18:02:05.774630Z","submitted_at":"2025-07-12T01:20:07Z","title":"Harnessing Text-to-Image Diffusion Models for Point Cloud Self-Supervised Learning","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-06T18:10:13.328625Z"},"links":{"citing_paper":"/paper/2507.09102"},"observation_digest":"sha256:5d8f8f2b90e2275695d33c85bddcd8ac6a0b39f0b2f2c5477e33282e2d3c11c9","observation_id":"9df3e67b-e750-44ee-91dd-60ba6ca0c5a2","resolution":{"observed_at":"2026-08-06T18:11:17.130508Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T18:10:13.357989Z","title":"Scannet: Richly-annotated 3d reconstructions of indoor scenes","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2507.09102","last_updated":"2025-07-12T01:20:07Z","snapshot_observed_at":"2026-08-06T18:02:05.774630Z","submitted_at":"2025-07-12T01:20:07Z","title":"Harnessing Text-to-Image Diffusion Models for Point Cloud Self-Supervised Learning","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-06T18:10:13.357989Z"},"links":{"citing_paper":"/paper/2507.09102"},"observation_digest":"sha256:62704136ad60e4857d6abff6c3ed58351d036a927dbb5470a1098fc2eff1e7d1","observation_id":"4352d4c7-4cf5-48ca-9866-97c57396780d","resolution":{"observed_at":"2026-08-06T18:10:13.357989Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1810.04805","last_updated":"2019-05-24T20:37:26Z","snapshot_observed_at":"2026-07-30T09:12:38.100527Z","submitted_at":"2018-10-11T00:50:01Z","title":"BERT: Pre-training of Deep Bidirectional Transformers for Language Understanding","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1810.04805","snapshot_observed_at":"2026-08-06T18:10:13.447665Z","title":"Bert: Pre-training of deep bidirectional transformers for language understanding.arXiv preprint arXiv:1810.04805, 2018","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2507.09102","last_updated":"2025-07-12T01:20:07Z","snapshot_observed_at":"2026-08-06T18:02:05.774630Z","submitted_at":"2025-07-12T01:20:07Z","title":"Harnessing Text-to-Image Diffusion Models for Point Cloud Self-Supervised Learning","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-06T18:10:13.447665Z"},"links":{"cited_paper":"/paper/1810.04805","citing_paper":"/paper/2507.09102"},"observation_digest":"sha256:19a0f8928e0df18a645fa7e6a4e90d648d91143fd124618587ab0ca098799740","observation_id":"aefa933c-376a-42c6-8969-a55e399c4e06","resolution":{"observed_at":"2026-08-06T18:10:13.447665Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T18:11:16.963897Z","title":null,"venue":null,"work_id":"289fbb0f-826c-43d7-b6b7-35a91a51b42a","year":null},"citing_paper":{"arxiv_id":"2507.09102","last_updated":"2025-07-12T01:20:07Z","snapshot_observed_at":"2026-08-06T18:02:05.774630Z","submitted_at":"2025-07-12T01:20:07Z","title":"Harnessing Text-to-Image Diffusion Models for Point Cloud Self-Supervised Learning","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-06T18:10:13.575189Z"},"links":{"citing_paper":"/paper/2507.09102"},"observation_digest":"sha256:47e6930a427b4cb8767cab2617c2efb7089409a587406510516f1e46325c94e1","observation_id":"76f2bf74-d093-4c97-90f0-660057f0f98b","resolution":{"observed_at":"2026-08-06T18:11:16.999867Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T18:11:16.854398Z","title":"Revisiting point cloud shape classification with a simple and effective baseline","venue":null,"work_id":"61bac70e-bf70-42c7-880f-8444971fbb8e","year":null},"citing_paper":{"arxiv_id":"2507.09102","last_updated":"2025-07-12T01:20:07Z","snapshot_observed_at":"2026-08-06T18:02:05.774630Z","submitted_at":"2025-07-12T01:20:07Z","title":"Harnessing Text-to-Image Diffusion Models for Point Cloud Self-Supervised Learning","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-06T18:10:13.653087Z"},"links":{"citing_paper":"/paper/2507.09102"},"observation_digest":"sha256:867b4603be4dc9b4b38253e5d5be17b006c8f7907b532537abb165ee0f26521e","observation_id":"42aa2748-5f36-4325-820d-d5dea85c746e","resolution":{"observed_at":"2026-08-06T18:11:16.907749Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T18:11:16.746183Z","title":"3d semantic segmentation with submani- fold sparse convolutional networks","venue":null,"work_id":"65715b86-ee61-4a7c-be9d-808021e2eda2","year":2018},"citing_paper":{"arxiv_id":"2507.09102","last_updated":"2025-07-12T01:20:07Z","snapshot_observed_at":"2026-08-06T18:02:05.774630Z","submitted_at":"2025-07-12T01:20:07Z","title":"Harnessing Text-to-Image Diffusion Models for Point Cloud Self-Supervised Learning","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-06T18:10:13.711407Z"},"links":{"citing_paper":"/paper/2507.09102"},"observation_digest":"sha256:0a99b676546c5a6fe4f5444427f36c13ef768e1c26f690fc945b41ba0568be67","observation_id":"6d07a70c-38c8-44bb-86a6-60fd9b51760e","resolution":{"observed_at":"2026-08-06T18:11:16.801989Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T18:11:16.567560Z","title":"Bootstrap your own latent-a new approach to self-supervised learning.Advances in neural information processing systems, 33:21271–21284, 2020","venue":null,"work_id":"eaf2868c-ed0e-4c95-8217-385199b57f59","year":2020},"citing_paper":{"arxiv_id":"2507.09102","last_updated":"2025-07-12T01:20:07Z","snapshot_observed_at":"2026-08-06T18:02:05.774630Z","submitted_at":"2025-07-12T01:20:07Z","title":"Harnessing Text-to-Image Diffusion Models for Point Cloud Self-Supervised Learning","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-06T18:10:13.775895Z"},"links":{"citing_paper":"/paper/2507.09102"},"observation_digest":"sha256:fdcdbf3e03bc7ac3b3924335cfd2678e52ad869c15d0a6a29b73fd553ca9b7c3","observation_id":"a7405aea-e35e-4194-8b82-71e9f41b4522","resolution":{"observed_at":"2026-08-06T18:11:16.659626Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2307.04725","last_updated":"2024-02-08T18:08:57Z","snapshot_observed_at":"2026-07-06T15:52:13.602170Z","submitted_at":"2023-07-10T17:34:16Z","title":"AnimateDiff: Animate Your Personalized Text-to-Image Diffusion Models without Specific Tuning","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2307.04725","snapshot_observed_at":"2026-08-06T18:10:13.937680Z","title":"Animatediff: Animate your personalized text-to-image diffusion models without specific tuning.arXiv preprint arXiv:2307.04725, 2023","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2507.09102","last_updated":"2025-07-12T01:20:07Z","snapshot_observed_at":"2026-08-06T18:02:05.774630Z","submitted_at":"2025-07-12T01:20:07Z","title":"Harnessing Text-to-Image Diffusion Models for Point Cloud Self-Supervised Learning","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-06T18:10:13.937680Z"},"links":{"cited_paper":"/paper/2307.04725","citing_paper":"/paper/2507.09102"},"observation_digest":"sha256:7b1e2b1162e4a268ef481ed9df390dd3971d78e66d717355556fda7bb85ee661","observation_id":"47b51c72-e53a-4ee8-8b29-eb0af7ace969","resolution":{"observed_at":"2026-08-06T18:10:13.937680Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2302.14007","last_updated":"2023-09-25T17:22:39Z","snapshot_observed_at":"2026-08-06T08:11:16.060565Z","submitted_at":"2023-02-27T17:56:18Z","title":"Joint-MAE: 2D-3D Joint Masked Autoencoders for 3D Point Cloud Pre-training","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2302.14007","snapshot_observed_at":"2026-08-06T18:10:13.986793Z","title":"Joint-mae: 2d-3d joint masked au- toencoders for 3d point cloud pre-training.arXiv preprint arXiv:2302.14007, 2023","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2507.09102","last_updated":"2025-07-12T01:20:07Z","snapshot_observed_at":"2026-08-06T18:02:05.774630Z","submitted_at":"2025-07-12T01:20:07Z","title":"Harnessing Text-to-Image Diffusion Models for Point Cloud Self-Supervised Learning","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-06T18:10:13.986793Z"},"links":{"cited_paper":"/paper/2302.14007","citing_paper":"/paper/2507.09102"},"observation_digest":"sha256:db7330ea327bc225b554610483e43260e0df665d17fbcbb6cf737f6bab3e5941","observation_id":"3b893064-dba0-4fe3-9606-5cc310dcbf84","resolution":{"observed_at":"2026-08-06T18:10:13.986793Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T18:11:16.426823Z","title":"Mvtn: Multi-view transformation network for 3d shape recognition","venue":null,"work_id":"8b5a191d-d53b-4b71-bb61-c2d12a3f8ad9","year":2021},"citing_paper":{"arxiv_id":"2507.09102","last_updated":"2025-07-12T01:20:07Z","snapshot_observed_at":"2026-08-06T18:02:05.774630Z","submitted_at":"2025-07-12T01:20:07Z","title":"Harnessing Text-to-Image Diffusion Models for Point Cloud Self-Supervised Learning","version":1},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-06T18:10:14.105673Z"},"links":{"citing_paper":"/paper/2507.09102"},"observation_digest":"sha256:ec42c136ba21bef3fedc1ec507555f7cb1b4eef183bdcfdde4cfaba347e32eee","observation_id":"12cb7dfd-7395-4c00-b674-cfd2161e5da0","resolution":{"observed_at":"2026-08-06T18:11:16.472891Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T18:11:16.269981Z","title":"Masked autoencoders are scalable vision learners","venue":null,"work_id":"0bc154d4-eaed-470b-843e-3362e45cc729","year":2022},"citing_paper":{"arxiv_id":"2507.09102","last_updated":"2025-07-12T01:20:07Z","snapshot_observed_at":"2026-08-06T18:02:05.774630Z","submitted_at":"2025-07-12T01:20:07Z","title":"Harnessing Text-to-Image Diffusion Models for Point Cloud Self-Supervised Learning","version":1},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-06T18:10:14.222816Z"},"links":{"citing_paper":"/paper/2507.09102"},"observation_digest":"sha256:99a2dd5e1ca075607018fc1e6a39a9d8d82377d5442711dcf1a93e1f4dc6a3fa","observation_id":"f27cb8ec-7a16-4363-9974-a8a2d859a43d","resolution":{"observed_at":"2026-08-06T18:11:16.353457Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T18:10:14.257395Z","title":"Denoising dif- fusion probabilistic models.Advances in neural information processing systems, 33:6840–6851, 2020","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2507.09102","last_updated":"2025-07-12T01:20:07Z","snapshot_observed_at":"2026-08-06T18:02:05.774630Z","submitted_at":"2025-07-12T01:20:07Z","title":"Harnessing Text-to-Image Diffusion Models for Point Cloud Self-Supervised Learning","version":1},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-06T18:10:14.257395Z"},"links":{"citing_paper":"/paper/2507.09102"},"observation_digest":"sha256:72905640d51bb0a2deb8071863045fd68933c2cf0ec9e91baa207a746e169ab8","observation_id":"70167a6a-f384-47dc-bb13-e3439fa70495","resolution":{"observed_at":"2026-08-06T18:10:14.257395Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T18:11:16.105125Z","title":"Regu- larization strategy for point cloud via rigidly mixed sample","venue":null,"work_id":"1d3beb73-9d4e-4527-a54a-29412ad9ff9b","year":2021},"citing_paper":{"arxiv_id":"2507.09102","last_updated":"2025-07-12T01:20:07Z","snapshot_observed_at":"2026-08-06T18:02:05.774630Z","submitted_at":"2025-07-12T01:20:07Z","title":"Harnessing Text-to-Image Diffusion Models for Point Cloud Self-Supervised Learning","version":1},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-06T18:10:14.298704Z"},"links":{"citing_paper":"/paper/2507.09102"},"observation_digest":"sha256:1101fd497a19bfdd0797bbdbaedc5507cfed3f9a83b58716edb255d95e5dc31f","observation_id":"4ec609ef-8241-4a18-8792-e716dab9f03c","resolution":{"observed_at":"2026-08-06T18:11:16.215343Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T18:10:14.340844Z","title":"Your diffusion model is secretly a zero-shot classifier","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2507.09102","last_updated":"2025-07-12T01:20:07Z","snapshot_observed_at":"2026-08-06T18:02:05.774630Z","submitted_at":"2025-07-12T01:20:07Z","title":"Harnessing Text-to-Image Diffusion Models for Point Cloud Self-Supervised Learning","version":1},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-06T18:10:14.340844Z"},"links":{"citing_paper":"/paper/2507.09102"},"observation_digest":"sha256:7b310725173b07464be2476667dc5c38e00dce669e9e33c65ff065cbd2380561","observation_id":"45094009-f6c7-4fca-be21-9c3db0e4dd68","resolution":{"observed_at":"2026-08-06T18:10:14.340844Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T18:11:15.945228Z","title":"Pointcnn: Convolution on x-transformed points","venue":null,"work_id":"f2b0556c-9fee-4523-8871-63afbc9deb4a","year":2018},"citing_paper":{"arxiv_id":"2507.09102","last_updated":"2025-07-12T01:20:07Z","snapshot_observed_at":"2026-08-06T18:02:05.774630Z","submitted_at":"2025-07-12T01:20:07Z","title":"Harnessing Text-to-Image Diffusion Models for Point Cloud Self-Supervised Learning","version":1},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-08-06T18:10:14.364934Z"},"links":{"citing_paper":"/paper/2507.09102"},"observation_digest":"sha256:daec935d5d861bd4e0ac760bd0c7a3b032f729cdfedc885bf1c2184879c5a598","observation_id":"2ae84e8a-8dba-4962-a28b-5eca27a83494","resolution":{"observed_at":"2026-08-06T18:11:16.011365Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T18:11:15.847286Z","title":"Masked discrim- ination for self-supervised learning on point clouds.Pro- ceedings of the European Conference on Computer Vision (ECCV), 2022","venue":null,"work_id":"70a27f9e-cf72-4f98-bfab-c6266ccce9ce","year":2022},"citing_paper":{"arxiv_id":"2507.09102","last_updated":"2025-07-12T01:20:07Z","snapshot_observed_at":"2026-08-06T18:02:05.774630Z","submitted_at":"2025-07-12T01:20:07Z","title":"Harnessing Text-to-Image Diffusion Models for Point Cloud Self-Supervised Learning","version":1},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-08-06T18:10:14.417199Z"},"links":{"citing_paper":"/paper/2507.09102"},"observation_digest":"sha256:846c9823caa52c95660c2ac51cc083c02f7556e4cfb4d3d17082d6bb40d4c415","observation_id":"cb035155-e7b6-4715-b182-30b30b957f83","resolution":{"observed_at":"2026-08-06T18:11:15.876039Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T18:11:15.723750Z","title":"Zero-1-to-3: Zero-shot one image to 3d object","venue":null,"work_id":"542aa0ff-4409-473c-b15c-a5d69e5b0e7f","year":2023},"citing_paper":{"arxiv_id":"2507.09102","last_updated":"2025-07-12T01:20:07Z","snapshot_observed_at":"2026-08-06T18:02:05.774630Z","submitted_at":"2025-07-12T01:20:07Z","title":"Harnessing Text-to-Image Diffusion Models for Point Cloud Self-Supervised Learning","version":1},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-08-06T18:10:14.460131Z"},"links":{"citing_paper":"/paper/2507.09102"},"observation_digest":"sha256:cfff81af327113013fadc00b66c72cab22fccf743f392526ca24a6328bdbe1e7","observation_id":"9b25c965-8b19-437e-8fff-24aeda182ac6","resolution":{"observed_at":"2026-08-06T18:11:15.800974Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2310.15008","last_updated":"2023-11-08T16:50:08Z","snapshot_observed_at":"2026-07-06T16:37:16.106127Z","submitted_at":"2023-10-23T15:02:23Z","title":"Wonder3D: Single Image to 3D using Cross-Domain Diffusion","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2310.15008","snapshot_observed_at":"2026-08-06T18:10:14.508003Z","title":"Wonder3d: Sin- gle image to 3d using cross-domain diffusion.arXiv preprint arXiv:2310.15008, 2023","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2507.09102","last_updated":"2025-07-12T01:20:07Z","snapshot_observed_at":"2026-08-06T18:02:05.774630Z","submitted_at":"2025-07-12T01:20:07Z","title":"Harnessing Text-to-Image Diffusion Models for Point Cloud Self-Supervised Learning","version":1},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-08-06T18:10:14.508003Z"},"links":{"cited_paper":"/paper/2310.15008","citing_paper":"/paper/2507.09102"},"observation_digest":"sha256:8b1e49e1471f3d9d15845ce1a7018801b135ee4fa4007e7f9cbbeab4803c88cf","observation_id":"cb137d2c-0f2c-4c85-b328-68cab4500cca","resolution":{"observed_at":"2026-08-06T18:10:14.508003Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1608.03983","last_updated":"2017-05-03T16:28:09Z","snapshot_observed_at":"2026-07-06T05:06:55.589962Z","submitted_at":"2016-08-13T13:46:05Z","title":"SGDR: Stochastic Gradient Descent with Warm Restarts","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1608.03983","snapshot_observed_at":"2026-08-06T18:10:14.569340Z","title":"Sgdr: Stochas- tic gradient descent with warm restarts.arXiv preprint arXiv:1608.03983, 2016","venue":null,"work_id":null,"year":2016},"citing_paper":{"arxiv_id":"2507.09102","last_updated":"2025-07-12T01:20:07Z","snapshot_observed_at":"2026-08-06T18:02:05.774630Z","submitted_at":"2025-07-12T01:20:07Z","title":"Harnessing Text-to-Image Diffusion Models for Point Cloud Self-Supervised Learning","version":1},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-08-06T18:10:14.569340Z"},"links":{"cited_paper":"/paper/1608.03983","citing_paper":"/paper/2507.09102"},"observation_digest":"sha256:da42c578a5aa45071c46255fa123c9293bccbdaac6e4229ae8747f988ffeafb4","observation_id":"ffb7f258-4d04-4017-8e5c-e82e988bde59","resolution":{"observed_at":"2026-08-06T18:10:14.569340Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1711.05101","last_updated":"2019-01-04T21:01:49Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2017-11-14T14:24:06Z","title":"Decoupled Weight Decay Regularization","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1711.05101","snapshot_observed_at":"2026-08-06T18:10:14.635657Z","title":"Decoupled weight decay regularization.arXiv preprint arXiv:1711.05101, 2017","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2507.09102","last_updated":"2025-07-12T01:20:07Z","snapshot_observed_at":"2026-08-06T18:02:05.774630Z","submitted_at":"2025-07-12T01:20:07Z","title":"Harnessing Text-to-Image Diffusion Models for Point Cloud Self-Supervised Learning","version":1},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-08-06T18:10:14.635657Z"},"links":{"cited_paper":"/paper/1711.05101","citing_paper":"/paper/2507.09102"},"observation_digest":"sha256:88627628d2cdc605bd02f230a46eb0bb66cd370136f5e8f30aa1b07e4d1538e3","observation_id":"cedad0d9-c625-4dd9-a621-d215f04a726d","resolution":{"observed_at":"2026-08-06T18:10:14.635657Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2202.07123","last_updated":"2022-11-29T07:07:37Z","snapshot_observed_at":"2026-08-02T22:08:27.106810Z","submitted_at":"2022-02-15T01:39:07Z","title":"Rethinking Network Design and Local Geometry in Point Cloud: A Simple Residual MLP Framework","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2202.07123","snapshot_observed_at":"2026-08-06T18:10:14.681106Z","title":"Rethinking network design and local geometry in point cloud: A simple residual mlp framework.arXiv preprint arXiv:2202.07123, 2022","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2507.09102","last_updated":"2025-07-12T01:20:07Z","snapshot_observed_at":"2026-08-06T18:02:05.774630Z","submitted_at":"2025-07-12T01:20:07Z","title":"Harnessing Text-to-Image Diffusion Models for Point Cloud Self-Supervised Learning","version":1},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-08-06T18:10:14.681106Z"},"links":{"cited_paper":"/paper/2202.07123","citing_paper":"/paper/2507.09102"},"observation_digest":"sha256:923fc951fa082197d41f31287e5d46aea866dff0d4a021d19757b754b2b7b8f5","observation_id":"d6f22c8d-9106-410c-9b5d-126bd5dc3d51","resolution":{"observed_at":"2026-08-06T18:10:14.681106Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T18:11:15.600717Z","title":"An end-to- end transformer model for 3d object detection","venue":null,"work_id":"3d51a2fc-a988-4f4a-921b-28505cceb8a3","year":2021},"citing_paper":{"arxiv_id":"2507.09102","last_updated":"2025-07-12T01:20:07Z","snapshot_observed_at":"2026-08-06T18:02:05.774630Z","submitted_at":"2025-07-12T01:20:07Z","title":"Harnessing Text-to-Image Diffusion Models for Point Cloud Self-Supervised Learning","version":1},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-08-06T18:10:14.711021Z"},"links":{"citing_paper":"/paper/2507.09102"},"observation_digest":"sha256:1ef6d2665641d2722e74957f22eeb8a762d7545d5165a5b814518e220714e6d6","observation_id":"168316dc-ad3c-4763-9011-0457bd9b8d21","resolution":{"observed_at":"2026-08-06T18:11:15.661110Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T18:11:15.539773Z","title":"Masked autoencoders for point cloud self-supervised learning","venue":null,"work_id":"00680f87-121c-4222-b957-c32ab796c4c2","year":2022},"citing_paper":{"arxiv_id":"2507.09102","last_updated":"2025-07-12T01:20:07Z","snapshot_observed_at":"2026-08-06T18:02:05.774630Z","submitted_at":"2025-07-12T01:20:07Z","title":"Harnessing Text-to-Image Diffusion Models for Point Cloud Self-Supervised Learning","version":1},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-08-06T18:10:14.757025Z"},"links":{"citing_paper":"/paper/2507.09102"},"observation_digest":"sha256:bca1cb0504d4ec6aa1404b85775b8d2611d3551fc203e5ae662ab6e4893b8f7f","observation_id":"70f384b5-cc7b-4664-9e94-64b567f8d61d","resolution":{"observed_at":"2026-08-06T18:11:15.554188Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T18:11:15.459625Z","title":"Diffusion autoen- coders: Toward a meaningful and decodable representation","venue":null,"work_id":"30b63b90-ed72-4226-9314-684624d50faa","year":2022},"citing_paper":{"arxiv_id":"2507.09102","last_updated":"2025-07-12T01:20:07Z","snapshot_observed_at":"2026-08-06T18:02:05.774630Z","submitted_at":"2025-07-12T01:20:07Z","title":"Harnessing Text-to-Image Diffusion Models for Point Cloud Self-Supervised Learning","version":1},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-08-06T18:10:14.807459Z"},"links":{"citing_paper":"/paper/2507.09102"},"observation_digest":"sha256:d508a20956472a0627efd19881cd7e6516552ca159fbd6fa75dffa983157582d","observation_id":"a9116193-ecc0-40b2-af28-701ebc7dd9ea","resolution":{"observed_at":"2026-08-06T18:11:15.490308Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T18:10:14.854852Z","title":"Pointnet: Deep learning on point sets for 3d classification and segmentation","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2507.09102","last_updated":"2025-07-12T01:20:07Z","snapshot_observed_at":"2026-08-06T18:02:05.774630Z","submitted_at":"2025-07-12T01:20:07Z","title":"Harnessing Text-to-Image Diffusion Models for Point Cloud Self-Supervised Learning","version":1},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-08-06T18:10:14.854852Z"},"links":{"citing_paper":"/paper/2507.09102"},"observation_digest":"sha256:5b31b7981d3dfebbcb7abb1a055941e29d365d8e4c65d7a695b8eeb4714a590d","observation_id":"1503f485-51e1-4f6f-959a-e6c2af3c9db3","resolution":{"observed_at":"2026-08-06T18:10:14.854852Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T18:11:15.344551Z","title":"Pointnet++: Deep hierarchical feature learning on point sets in a metric space.Advances in neural information processing systems, 30, 2017","venue":null,"work_id":"123c4a7c-7883-4749-82b8-5ec105d058f8","year":2017},"citing_paper":{"arxiv_id":"2507.09102","last_updated":"2025-07-12T01:20:07Z","snapshot_observed_at":"2026-08-06T18:02:05.774630Z","submitted_at":"2025-07-12T01:20:07Z","title":"Harnessing Text-to-Image Diffusion Models for Point Cloud Self-Supervised Learning","version":1},"reference_index":36,"source":"pdf_text","source_observed_at":"2026-08-06T18:10:14.879216Z"},"links":{"citing_paper":"/paper/2507.09102"},"observation_digest":"sha256:587f987b6006cf551599539c4a84c757ef6e6e77fc2ab43f0967b1d9b12bb35f","observation_id":"d40ed85e-8b65-481b-89fc-d62c883cebb3","resolution":{"observed_at":"2026-08-06T18:11:15.380699Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T18:11:15.270808Z","title":"Contrast with reconstruct: Contrastive 3d representation learning guided by generative pretraining","venue":null,"work_id":"aa4adc5b-2127-474b-8eec-975895c7d6a3","year":2023},"citing_paper":{"arxiv_id":"2507.09102","last_updated":"2025-07-12T01:20:07Z","snapshot_observed_at":"2026-08-06T18:02:05.774630Z","submitted_at":"2025-07-12T01:20:07Z","title":"Harnessing Text-to-Image Diffusion Models for Point Cloud Self-Supervised Learning","version":1},"reference_index":37,"source":"pdf_text","source_observed_at":"2026-08-06T18:10:14.902598Z"},"links":{"citing_paper":"/paper/2507.09102"},"observation_digest":"sha256:fc90c2659b08305e629c59c58c92c23ecd6864f7963cefec0c7861db8069d39d","observation_id":"2289abe0-1bac-4de8-bf60-e2b5d8a9f704","resolution":{"observed_at":"2026-08-06T18:11:15.296402Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T18:11:15.129574Z","title":"Pointnext: Revisiting pointnet++ with improved training and scaling strategies","venue":null,"work_id":"9bbcab4f-136d-4892-bf98-56dbd03d323e","year":2022},"citing_paper":{"arxiv_id":"2507.09102","last_updated":"2025-07-12T01:20:07Z","snapshot_observed_at":"2026-08-06T18:02:05.774630Z","submitted_at":"2025-07-12T01:20:07Z","title":"Harnessing Text-to-Image Diffusion Models for Point Cloud Self-Supervised Learning","version":1},"reference_index":38,"source":"pdf_text","source_observed_at":"2026-08-06T18:10:14.933504Z"},"links":{"citing_paper":"/paper/2507.09102"},"observation_digest":"sha256:f593ca03569d5b2c37ea7cd4735751c7de772a911fdc0201fc3bfc1332291fd5","observation_id":"7757d46e-9ba8-474d-83ef-9ad85fd16efa","resolution":{"observed_at":"2026-08-06T18:11:15.178206Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T18:11:15.036478Z","title":"Learning transferable visual models from natural language supervi- sion","venue":null,"work_id":"2a017634-0015-4600-b62f-77283ae36f47","year":2021},"citing_paper":{"arxiv_id":"2507.09102","last_updated":"2025-07-12T01:20:07Z","snapshot_observed_at":"2026-08-06T18:02:05.774630Z","submitted_at":"2025-07-12T01:20:07Z","title":"Harnessing Text-to-Image Diffusion Models for Point Cloud Self-Supervised Learning","version":1},"reference_index":39,"source":"pdf_text","source_observed_at":"2026-08-06T18:10:14.971120Z"},"links":{"citing_paper":"/paper/2507.09102"},"observation_digest":"sha256:1cd6b5aa5d4fc153751f0a83e01d2dd8e740d61730f86044773bbbdf71da9c9b","observation_id":"248b25d1-1542-4232-93e5-212ddbaa79f8","resolution":{"observed_at":"2026-08-06T18:11:15.080289Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T18:11:14.938784Z","title":"Exploring the limits of transfer learning with a unified text-to-text transformer.Journal of machine learning research, 21(140):1–67, 2020","venue":null,"work_id":"20437233-978f-41b0-a308-b17100e2a8ec","year":2020},"citing_paper":{"arxiv_id":"2507.09102","last_updated":"2025-07-12T01:20:07Z","snapshot_observed_at":"2026-08-06T18:02:05.774630Z","submitted_at":"2025-07-12T01:20:07Z","title":"Harnessing Text-to-Image Diffusion Models for Point Cloud Self-Supervised Learning","version":1},"reference_index":40,"source":"pdf_text","source_observed_at":"2026-08-06T18:10:15.018244Z"},"links":{"citing_paper":"/paper/2507.09102"},"observation_digest":"sha256:c87997a9a50d782958196a6c2f27201e9e27b24de57cfba29dd3f8f4798f31c8","observation_id":"6bcf9ebd-e919-4607-a6c8-27547fa3360c","resolution":{"observed_at":"2026-08-06T18:11:14.979594Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T18:11:14.918552Z","title":"High-resolution image synthesis with latent diffusion models","venue":null,"work_id":"17300827-3a2a-4d4c-a110-5c5386585f9a","year":2022},"citing_paper":{"arxiv_id":"2507.09102","last_updated":"2025-07-12T01:20:07Z","snapshot_observed_at":"2026-08-06T18:02:05.774630Z","submitted_at":"2025-07-12T01:20:07Z","title":"Harnessing Text-to-Image Diffusion Models for Point Cloud Self-Supervised Learning","version":1},"reference_index":41,"source":"pdf_text","source_observed_at":"2026-08-06T18:10:15.047622Z"},"links":{"citing_paper":"/paper/2507.09102"},"observation_digest":"sha256:dd37eaac14a85db13ae1e226d29057acebaac634afb897c0fe6588df74428b45","observation_id":"ceb31386-37b1-4328-954a-0afdb27f2c3e","resolution":{"observed_at":"2026-08-06T18:11:14.925335Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T18:11:14.864207Z","title":"Self-supervised few-shot learning on point clouds.Advances in Neural Information Processing Systems, 33:7212–7221, 2020","venue":null,"work_id":"324a4cef-2933-4a4d-b3df-0a290ce4f880","year":2020},"citing_paper":{"arxiv_id":"2507.09102","last_updated":"2025-07-12T01:20:07Z","snapshot_observed_at":"2026-08-06T18:02:05.774630Z","submitted_at":"2025-07-12T01:20:07Z","title":"Harnessing Text-to-Image Diffusion Models for Point Cloud Self-Supervised Learning","version":1},"reference_index":42,"source":"pdf_text","source_observed_at":"2026-08-06T18:10:15.100262Z"},"links":{"citing_paper":"/paper/2507.09102"},"observation_digest":"sha256:99bfe262bf4fa080b371da8bff7819d78416a39591d498d35001f79e5cc8bdff","observation_id":"b9547a7f-5bbf-416a-8296-624be2fb104c","resolution":{"observed_at":"2026-08-06T18:11:14.894542Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2308.16512","last_updated":"2024-04-18T04:12:32Z","snapshot_observed_at":"2026-07-06T16:12:38.269310Z","submitted_at":"2023-08-31T07:49:06Z","title":"MVDream: Multi-view Diffusion for 3D Generation","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2308.16512","snapshot_observed_at":"2026-08-06T18:10:15.153625Z","title":"Mvdream: Multi-view diffusion for 3d gen- eration.arXiv preprint arXiv:2308.16512, 2023","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2507.09102","last_updated":"2025-07-12T01:20:07Z","snapshot_observed_at":"2026-08-06T18:02:05.774630Z","submitted_at":"2025-07-12T01:20:07Z","title":"Harnessing Text-to-Image Diffusion Models for Point Cloud Self-Supervised Learning","version":1},"reference_index":43,"source":"pdf_text","source_observed_at":"2026-08-06T18:10:15.153625Z"},"links":{"cited_paper":"/paper/2308.16512","citing_paper":"/paper/2507.09102"},"observation_digest":"sha256:ee86e577241b4b33688793edbad8a5ebc682abe3ca1aa2fab9e03dd28c7f4b6a","observation_id":"5985ab1e-ef0e-4368-8550-dd410708fd3c","resolution":{"observed_at":"2026-08-06T18:10:15.153625Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T18:11:14.808524Z","title":"Deep unsupervised learning using nonequilibrium thermodynamics","venue":null,"work_id":"4d9c7d0a-3bd5-4eaf-9eca-2c7b7910216f","year":2015},"citing_paper":{"arxiv_id":"2507.09102","last_updated":"2025-07-12T01:20:07Z","snapshot_observed_at":"2026-08-06T18:02:05.774630Z","submitted_at":"2025-07-12T01:20:07Z","title":"Harnessing Text-to-Image Diffusion Models for Point Cloud Self-Supervised Learning","version":1},"reference_index":44,"source":"pdf_text","source_observed_at":"2026-08-06T18:10:15.188239Z"},"links":{"citing_paper":"/paper/2507.09102"},"observation_digest":"sha256:4508cc38e31e726d039e7b4df6587a180c70d2703602b0a835286a8a07d3ac31","observation_id":"95a23cb5-3daf-4b19-b22c-bb9bd1f0d04a","resolution":{"observed_at":"2026-08-06T18:11:14.825920Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T18:11:14.653623Z","title":"Epmf: Efficient perception-aware multi-sensor fusion for 3d semantic seg- mentation.IEEE Transactions on Pattern Analysis and Ma- chine Intelligence, 46(12):8258–8273, 2024","venue":null,"work_id":"0cd51e8d-ba5a-4d6f-8d4e-e5197c35c5ce","year":2024},"citing_paper":{"arxiv_id":"2507.09102","last_updated":"2025-07-12T01:20:07Z","snapshot_observed_at":"2026-08-06T18:02:05.774630Z","submitted_at":"2025-07-12T01:20:07Z","title":"Harnessing Text-to-Image Diffusion Models for Point Cloud Self-Supervised Learning","version":1},"reference_index":45,"source":"pdf_text","source_observed_at":"2026-08-06T18:10:15.222544Z"},"links":{"citing_paper":"/paper/2507.09102"},"observation_digest":"sha256:e1227f73d66f1521b149912abb24eb7e2d76fe1dccd2ee8443a0de78cfc61ee5","observation_id":"c94390ee-c1c8-4171-9882-ea89a3f597cf","resolution":{"observed_at":"2026-08-06T18:11:14.716318Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2308.12469","last_updated":"2024-04-02T17:40:03Z","snapshot_observed_at":"2026-07-06T16:09:44.283461Z","submitted_at":"2023-08-23T23:44:44Z","title":"Diffuse, Attend, and Segment: Unsupervised Zero-Shot Segmentation using Stable Diffusion","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2308.12469","snapshot_observed_at":"2026-08-06T18:10:15.259656Z","title":"Diffuse, attend, and segment: Unsupervised zero-shot segmentation using stable diffusion","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2507.09102","last_updated":"2025-07-12T01:20:07Z","snapshot_observed_at":"2026-08-06T18:02:05.774630Z","submitted_at":"2025-07-12T01:20:07Z","title":"Harnessing Text-to-Image Diffusion Models for Point Cloud Self-Supervised Learning","version":1},"reference_index":46,"source":"pdf_text","source_observed_at":"2026-08-06T18:10:15.259656Z"},"links":{"cited_paper":"/paper/2308.12469","citing_paper":"/paper/2507.09102"},"observation_digest":"sha256:22c06ad438d3571fe9798f1cd1e5590c3ab731ec47bce0d97111d5f9a1d98983","observation_id":"44523044-c91c-4f82-b234-3f09335abca7","resolution":{"observed_at":"2026-08-06T18:10:15.259656Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T18:11:14.539411Z","title":"Revisiting point cloud classification: A new benchmark dataset and classification model on real-world data","venue":null,"work_id":"e373b027-3024-4859-9286-314eee3c9186","year":2019},"citing_paper":{"arxiv_id":"2507.09102","last_updated":"2025-07-12T01:20:07Z","snapshot_observed_at":"2026-08-06T18:02:05.774630Z","submitted_at":"2025-07-12T01:20:07Z","title":"Harnessing Text-to-Image Diffusion Models for Point Cloud Self-Supervised Learning","version":1},"reference_index":47,"source":"pdf_text","source_observed_at":"2026-08-06T18:10:15.308344Z"},"links":{"citing_paper":"/paper/2507.09102"},"observation_digest":"sha256:cb9ae587ee9c1ea70fb77b55a7eb0189960df4f7a90488b005b01af0638ad7c2","observation_id":"e61adc65-3d64-47b0-b4d0-e2b983756779","resolution":{"observed_at":"2026-08-06T18:11:14.583484Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T18:11:14.431947Z","title":"Visualizing data using t-sne.Journal of machine learning research, 9 (11), 2008","venue":null,"work_id":"16294daa-2c8e-4c1f-8333-f463ab03c27c","year":2008},"citing_paper":{"arxiv_id":"2507.09102","last_updated":"2025-07-12T01:20:07Z","snapshot_observed_at":"2026-08-06T18:02:05.774630Z","submitted_at":"2025-07-12T01:20:07Z","title":"Harnessing Text-to-Image Diffusion Models for Point Cloud Self-Supervised Learning","version":1},"reference_index":48,"source":"pdf_text","source_observed_at":"2026-08-06T18:10:15.339098Z"},"links":{"citing_paper":"/paper/2507.09102"},"observation_digest":"sha256:851c8e5614d11b6ada9a671b2a093dfe4d2d1ea513c6ecead290b50a2bc01a86","observation_id":"29e0b7c9-69b9-4b75-8100-3ff01728982f","resolution":{"observed_at":"2026-08-06T18:11:14.498983Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T18:11:14.291813Z","title":"Dynamic graph cnn for learning on point clouds.ACM Transactions on Graphics (tog), 38(5):1–12, 2019","venue":null,"work_id":"f5b4a4e3-4e3d-455e-9d11-25e59c296733","year":2019},"citing_paper":{"arxiv_id":"2507.09102","last_updated":"2025-07-12T01:20:07Z","snapshot_observed_at":"2026-08-06T18:02:05.774630Z","submitted_at":"2025-07-12T01:20:07Z","title":"Harnessing Text-to-Image Diffusion Models for Point Cloud Self-Supervised Learning","version":1},"reference_index":49,"source":"pdf_text","source_observed_at":"2026-08-06T18:10:15.381365Z"},"links":{"citing_paper":"/paper/2507.09102"},"observation_digest":"sha256:bb6c6cde829ccbe0e387563853828c112154df212c3f5972168d91f7433243e1","observation_id":"2fe7fb8e-f7d4-471f-9878-d62dcb6b41eb","resolution":{"observed_at":"2026-08-06T18:11:14.353991Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T18:10:19.903144Z","title":"Pointpatchmix: Point cloud mixing with patch scoring","venue":null,"work_id":"8198e5ce-989f-4ff6-84c1-a75a63b89b4b","year":2024},"citing_paper":{"arxiv_id":"2507.09102","last_updated":"2025-07-12T01:20:07Z","snapshot_observed_at":"2026-08-06T18:02:05.774630Z","submitted_at":"2025-07-12T01:20:07Z","title":"Harnessing Text-to-Image Diffusion Models for Point Cloud Self-Supervised Learning","version":1},"reference_index":50,"source":"pdf_text","source_observed_at":"2026-08-06T18:10:15.417288Z"},"links":{"citing_paper":"/paper/2507.09102"},"observation_digest":"sha256:85f6ed61eeb10c4376eefa3d27e6c8a1a35f7d6551e4afabf5a9491238d5092f","observation_id":"c2119a06-14b0-4db5-b438-2d21d658377e","resolution":{"observed_at":"2026-08-06T18:10:19.943217Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T18:10:19.729339Z","title":"P2p: Tuning pre-trained image models for point cloud analysis with point-to-pixel prompting","venue":null,"work_id":"a64eed4f-65be-443a-af0c-d5df6b6a1c2c","year":2022},"citing_paper":{"arxiv_id":"2507.09102","last_updated":"2025-07-12T01:20:07Z","snapshot_observed_at":"2026-08-06T18:02:05.774630Z","submitted_at":"2025-07-12T01:20:07Z","title":"Harnessing Text-to-Image Diffusion Models for Point Cloud Self-Supervised Learning","version":1},"reference_index":51,"source":"pdf_text","source_observed_at":"2026-08-06T18:10:15.460912Z"},"links":{"citing_paper":"/paper/2507.09102"},"observation_digest":"sha256:2f7bb02da938de7e6748202d6ba2f95a20fa5a22ff35988e517b514f83bdfa45","observation_id":"098ad68a-2033-460c-be2d-b0d916872135","resolution":{"observed_at":"2026-08-06T18:10:19.842472Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T18:10:19.586864Z","title":"Take-a-photo: 3d-to-2d generative pre-training of point cloud models","venue":null,"work_id":"ae5a9728-eaa0-4af0-86d8-1a2fc1113bb4","year":null},"citing_paper":{"arxiv_id":"2507.09102","last_updated":"2025-07-12T01:20:07Z","snapshot_observed_at":"2026-08-06T18:02:05.774630Z","submitted_at":"2025-07-12T01:20:07Z","title":"Harnessing Text-to-Image Diffusion Models for Point Cloud Self-Supervised Learning","version":1},"reference_index":52,"source":"pdf_text","source_observed_at":"2026-08-06T18:10:15.493693Z"},"links":{"citing_paper":"/paper/2507.09102"},"observation_digest":"sha256:91ecf162c3d2bf7f0c867ff317833d9f074baf248e218d750c80e4addba8cc48","observation_id":"a7c23fa9-d9e2-45ef-80b6-7054463e85ca","resolution":{"observed_at":"2026-08-06T18:10:19.637186Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T18:10:19.468786Z","title":"3d shapenets: A deep representation for volumetric shapes","venue":null,"work_id":"b1db23ea-3eb8-4fa6-ab01-542924240de8","year":1912},"citing_paper":{"arxiv_id":"2507.09102","last_updated":"2025-07-12T01:20:07Z","snapshot_observed_at":"2026-08-06T18:02:05.774630Z","submitted_at":"2025-07-12T01:20:07Z","title":"Harnessing Text-to-Image Diffusion Models for Point Cloud Self-Supervised Learning","version":1},"reference_index":53,"source":"pdf_text","source_observed_at":"2026-08-06T18:10:15.537024Z"},"links":{"citing_paper":"/paper/2507.09102"},"observation_digest":"sha256:db0b0aad71fd7e2c6c9cd2455e21b4870f18f07abfc063e8de86884963523bbf","observation_id":"6907f1aa-268c-4299-8090-52a2dfe58efa","resolution":{"observed_at":"2026-08-06T18:10:19.531932Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T18:10:19.385174Z","title":"Pointcontrast: Unsupervised pre- training for 3d point cloud understanding","venue":null,"work_id":"240e309b-825f-453e-946c-d548811d252d","year":2020},"citing_paper":{"arxiv_id":"2507.09102","last_updated":"2025-07-12T01:20:07Z","snapshot_observed_at":"2026-08-06T18:02:05.774630Z","submitted_at":"2025-07-12T01:20:07Z","title":"Harnessing Text-to-Image Diffusion Models for Point Cloud Self-Supervised Learning","version":1},"reference_index":54,"source":"pdf_text","source_observed_at":"2026-08-06T18:10:15.600318Z"},"links":{"citing_paper":"/paper/2507.09102"},"observation_digest":"sha256:b40105de6c412ec404e35afe774a891ddcbee9523eb912a37cce4762c29c6331","observation_id":"c4715f67-a684-46ab-a8f1-10e0d9d177c0","resolution":{"observed_at":"2026-08-06T18:10:19.424424Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T18:10:19.223013Z","title":"Ulip: Learning a unified representation of language, images, and point clouds for 3d understanding","venue":null,"work_id":"0aa1961b-b9fc-40c2-bf2a-397b51b034eb","year":2023},"citing_paper":{"arxiv_id":"2507.09102","last_updated":"2025-07-12T01:20:07Z","snapshot_observed_at":"2026-08-06T18:02:05.774630Z","submitted_at":"2025-07-12T01:20:07Z","title":"Harnessing Text-to-Image Diffusion Models for Point Cloud Self-Supervised Learning","version":1},"reference_index":55,"source":"pdf_text","source_observed_at":"2026-08-06T18:10:15.609593Z"},"links":{"citing_paper":"/paper/2507.09102"},"observation_digest":"sha256:ec1dcaf2c1667ebab30ca1f2dfe2daaefbb3ee93b87bab182cfd076364140d8c","observation_id":"04783218-b9a9-4fed-bebf-262dcea90f5f","resolution":{"observed_at":"2026-08-06T18:10:19.254793Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T18:10:15.697363Z","title":"Ulip-2: Towards scalable multimodal pre-training for 3d understanding","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.09102","last_updated":"2025-07-12T01:20:07Z","snapshot_observed_at":"2026-08-06T18:02:05.774630Z","submitted_at":"2025-07-12T01:20:07Z","title":"Harnessing Text-to-Image Diffusion Models for Point Cloud Self-Supervised Learning","version":1},"reference_index":56,"source":"pdf_text","source_observed_at":"2026-08-06T18:10:15.697363Z"},"links":{"citing_paper":"/paper/2507.09102"},"observation_digest":"sha256:ee898f6d4aebca8ae310e3393ae319d9f4e1482eed9a14d6d777fce1d0a5f478","observation_id":"857aab2a-324f-4313-a06e-5e1a175b5a85","resolution":{"observed_at":"2026-08-06T18:10:15.697363Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T18:10:19.115622Z","title":"Gd-mae: gen- erative decoder for mae pre-training on lidar point clouds","venue":null,"work_id":"065a79ef-3fc1-496d-882a-6b29c5d41aaa","year":2023},"citing_paper":{"arxiv_id":"2507.09102","last_updated":"2025-07-12T01:20:07Z","snapshot_observed_at":"2026-08-06T18:02:05.774630Z","submitted_at":"2025-07-12T01:20:07Z","title":"Harnessing Text-to-Image Diffusion Models for Point Cloud Self-Supervised Learning","version":1},"reference_index":57,"source":"pdf_text","source_observed_at":"2026-08-06T18:10:15.807452Z"},"links":{"citing_paper":"/paper/2507.09102"},"observation_digest":"sha256:8d937b9215f8ca7bb98922f7f1b67fc6f3195c4aa08fab318b9d1f1a009c778b","observation_id":"d086ba09-88db-4d52-8c5d-453f971157e5","resolution":{"observed_at":"2026-08-06T18:10:19.146285Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2301.13721","last_updated":"2023-10-28T11:21:47Z","snapshot_observed_at":"2026-08-04T23:42:21.771516Z","submitted_at":"2023-01-31T15:58:32Z","title":"DisDiff: Unsupervised Disentanglement of Diffusion Probabilistic Models","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2301.13721","snapshot_observed_at":"2026-08-06T18:10:15.836359Z","title":"Dis- diff: Unsupervised disentanglement of diffusion probabilis- tic models.arXiv preprint arXiv:2301.13721, 2023","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2507.09102","last_updated":"2025-07-12T01:20:07Z","snapshot_observed_at":"2026-08-06T18:02:05.774630Z","submitted_at":"2025-07-12T01:20:07Z","title":"Harnessing Text-to-Image Diffusion Models for Point Cloud Self-Supervised Learning","version":1},"reference_index":58,"source":"pdf_text","source_observed_at":"2026-08-06T18:10:15.836359Z"},"links":{"cited_paper":"/paper/2301.13721","citing_paper":"/paper/2507.09102"},"observation_digest":"sha256:cf0d9b5d85889aa51bc17705326a11c434d901c284d80f964555f70bcf5cb507","observation_id":"2702fef2-ca23-452c-b9b1-28eb39d806c0","resolution":{"observed_at":"2026-08-06T18:10:15.836359Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2402.09712","last_updated":"2024-06-12T15:20:36Z","snapshot_observed_at":"2026-08-07T02:18:16.237014Z","submitted_at":"2024-02-15T05:07:54Z","title":"Diffusion Model with Cross Attention as an Inductive Bias for Disentanglement","version":2},"cited_work":{"arxiv_id":"2402.09712","doi":null,"metadata_source":"pith","pith_arxiv_id":"2402.09712","snapshot_observed_at":"2026-08-06T18:10:16.995587Z","title":"Diffusion Model with Cross Attention as an Inductive Bias for Disentanglement","venue":"cs.CV","work_id":"6adfdd6c-c964-4141-974f-64759a4b6523","year":2024},"citing_paper":{"arxiv_id":"2507.09102","last_updated":"2025-07-12T01:20:07Z","snapshot_observed_at":"2026-08-06T18:02:05.774630Z","submitted_at":"2025-07-12T01:20:07Z","title":"Harnessing Text-to-Image Diffusion Models for Point Cloud Self-Supervised Learning","version":1},"reference_index":59,"source":"pdf_text","source_observed_at":"2026-08-06T18:10:15.899434Z"},"links":{"cited_paper":"/paper/2402.09712","citing_paper":"/paper/2507.09102"},"observation_digest":"sha256:8d95a83ca3af635404cd23e2eaaca3e49f1037e67cc403b5b1f3fdcb52a70b5d","observation_id":"b29f7a7f-80da-4892-9dfd-2e47121c104d","resolution":{"observed_at":"2026-08-06T18:10:17.153766Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T18:10:18.982398Z","title":"A scalable active framework for region annotation in 3d shape collections.ACM Transactions on Graphics (ToG), 35(6):1–12, 2016","venue":null,"work_id":"e10ae059-953a-4b5a-9173-2884ccc28c79","year":2016},"citing_paper":{"arxiv_id":"2507.09102","last_updated":"2025-07-12T01:20:07Z","snapshot_observed_at":"2026-08-06T18:02:05.774630Z","submitted_at":"2025-07-12T01:20:07Z","title":"Harnessing Text-to-Image Diffusion Models for Point Cloud Self-Supervised Learning","version":1},"reference_index":60,"source":"pdf_text","source_observed_at":"2026-08-06T18:10:15.982409Z"},"links":{"citing_paper":"/paper/2507.09102"},"observation_digest":"sha256:4e41611d51dd3e8cdacc517832b4b04ecb30e14fabae4ce15b0a8909e4b58bae","observation_id":"444bc779-e0af-47e1-99bf-c33aaa53aa0b","resolution":{"observed_at":"2026-08-06T18:10:19.057909Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T18:10:18.812173Z","title":"Point-bert: Pre-training 3d point cloud transformers with masked point modeling","venue":null,"work_id":"ca7ffa77-a47e-4611-814f-612b275a9631","year":2022},"citing_paper":{"arxiv_id":"2507.09102","last_updated":"2025-07-12T01:20:07Z","snapshot_observed_at":"2026-08-06T18:02:05.774630Z","submitted_at":"2025-07-12T01:20:07Z","title":"Harnessing Text-to-Image Diffusion Models for Point Cloud Self-Supervised Learning","version":1},"reference_index":61,"source":"pdf_text","source_observed_at":"2026-08-06T18:10:16.040475Z"},"links":{"citing_paper":"/paper/2507.09102"},"observation_digest":"sha256:c3a882d44cf543afe59ada2441eb0ebff4412cd305ba2e4b749b83d8b730241e","observation_id":"9d3611d4-4fdb-4d04-805d-1331c51f596f","resolution":{"observed_at":"2026-08-06T18:10:18.916090Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2401.11430","last_updated":"2024-01-21T08:35:25Z","snapshot_observed_at":"2026-07-06T17:18:24.209069Z","submitted_at":"2024-01-21T08:35:25Z","title":"Exploring Diffusion Time-steps for Unsupervised Representation Learning","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2401.11430","snapshot_observed_at":"2026-08-06T18:10:16.121566Z","title":"Exploring diffusion time- steps for unsupervised representation learning.arXiv preprint arXiv:2401.11430, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.09102","last_updated":"2025-07-12T01:20:07Z","snapshot_observed_at":"2026-08-06T18:02:05.774630Z","submitted_at":"2025-07-12T01:20:07Z","title":"Harnessing Text-to-Image Diffusion Models for Point Cloud Self-Supervised Learning","version":1},"reference_index":62,"source":"pdf_text","source_observed_at":"2026-08-06T18:10:16.121566Z"},"links":{"cited_paper":"/paper/2401.11430","citing_paper":"/paper/2507.09102"},"observation_digest":"sha256:dfcd8bc38cf5a7e99a362e205ce5d3eb6f18fc6ce3194bb68e6eda03697088e9","observation_id":"90f08ac1-a6d5-43ea-b5e6-3cd0cd96dd24","resolution":{"observed_at":"2026-08-06T18:10:16.121566Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2312.10726","last_updated":"2023-12-17T14:17:05Z","snapshot_observed_at":"2026-07-06T17:04:13.625458Z","submitted_at":"2023-12-17T14:17:05Z","title":"Towards Compact 3D Representations via Point Feature Enhancement Masked Autoencoders","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2312.10726","snapshot_observed_at":"2026-08-06T18:10:16.218975Z","title":"Towards compact 3d representations via point feature enhancement masked au- toencoders.arXiv preprint arXiv:2312.10726, 2023","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2507.09102","last_updated":"2025-07-12T01:20:07Z","snapshot_observed_at":"2026-08-06T18:02:05.774630Z","submitted_at":"2025-07-12T01:20:07Z","title":"Harnessing Text-to-Image Diffusion Models for Point Cloud Self-Supervised Learning","version":1},"reference_index":63,"source":"pdf_text","source_observed_at":"2026-08-06T18:10:16.218975Z"},"links":{"cited_paper":"/paper/2312.10726","citing_paper":"/paper/2507.09102"},"observation_digest":"sha256:a43124adce73b98b68dd8463bf081b6467da2bd835cf3155ac6b7e22b499dce2","observation_id":"5bbc99fa-d16f-4670-8c07-739437aa0a88","resolution":{"observed_at":"2026-08-06T18:10:16.218975Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T18:10:18.644469Z","title":"Point-m2ae: multi-scale masked autoencoders for hierarchical point cloud pre-training.Advances in neural information processing sys- tems, 35:27061–27074, 2022","venue":null,"work_id":"1c954a2a-c7c5-44b4-80ce-f6b51dc2f5c1","year":2022},"citing_paper":{"arxiv_id":"2507.09102","last_updated":"2025-07-12T01:20:07Z","snapshot_observed_at":"2026-08-06T18:02:05.774630Z","submitted_at":"2025-07-12T01:20:07Z","title":"Harnessing Text-to-Image Diffusion Models for Point Cloud Self-Supervised Learning","version":1},"reference_index":64,"source":"pdf_text","source_observed_at":"2026-08-06T18:10:16.262742Z"},"links":{"citing_paper":"/paper/2507.09102"},"observation_digest":"sha256:735b12bb614868eaa8f3df273dec183c18a7e8f2ba733c2260fbc2d5f7493789","observation_id":"062c784a-ff7c-46e4-bdbd-769934e37865","resolution":{"observed_at":"2026-08-06T18:10:18.751622Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T18:10:18.461364Z","title":"Learning 3d representations from 2d pre-trained models via image-to-point masked autoencoders","venue":null,"work_id":"7af1487c-4f57-4d56-934f-c92c611c967c","year":2023},"citing_paper":{"arxiv_id":"2507.09102","last_updated":"2025-07-12T01:20:07Z","snapshot_observed_at":"2026-08-06T18:02:05.774630Z","submitted_at":"2025-07-12T01:20:07Z","title":"Harnessing Text-to-Image Diffusion Models for Point Cloud Self-Supervised Learning","version":1},"reference_index":65,"source":"pdf_text","source_observed_at":"2026-08-06T18:10:16.346704Z"},"links":{"citing_paper":"/paper/2507.09102"},"observation_digest":"sha256:ea3f28cbd2df3981ea16b0fbdbd8cbaddead177bef24102a0566bdbffa1b6138","observation_id":"57507315-8fa4-4214-b946-55bc81e2cae1","resolution":{"observed_at":"2026-08-06T18:10:18.529515Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T18:10:18.323908Z","title":"Self-supervised pretraining of 3d features on any point-cloud","venue":null,"work_id":"91f892da-e1ed-489f-a364-c23b3e0d037f","year":2021},"citing_paper":{"arxiv_id":"2507.09102","last_updated":"2025-07-12T01:20:07Z","snapshot_observed_at":"2026-08-06T18:02:05.774630Z","submitted_at":"2025-07-12T01:20:07Z","title":"Harnessing Text-to-Image Diffusion Models for Point Cloud Self-Supervised Learning","version":1},"reference_index":66,"source":"pdf_text","source_observed_at":"2026-08-06T18:10:16.421860Z"},"links":{"citing_paper":"/paper/2507.09102"},"observation_digest":"sha256:067ab7c3be9f7726d85ed136d6391e18031d2471d714ed87661a71db4cb9f3a0","observation_id":"c01214c0-4e5d-4f72-bd94-fd91a4c26d09","resolution":{"observed_at":"2026-08-06T18:10:18.380825Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T18:10:18.227131Z","title":"Unsupervised rep- resentation learning from pre-trained diffusion probabilistic models.Advances in Neural Information Processing Sys- tems, 35:22117–22130, 2022","venue":null,"work_id":"a14907d0-b682-44e9-bf37-4285021322db","year":2022},"citing_paper":{"arxiv_id":"2507.09102","last_updated":"2025-07-12T01:20:07Z","snapshot_observed_at":"2026-08-06T18:02:05.774630Z","submitted_at":"2025-07-12T01:20:07Z","title":"Harnessing Text-to-Image Diffusion Models for Point Cloud Self-Supervised Learning","version":1},"reference_index":67,"source":"pdf_text","source_observed_at":"2026-08-06T18:10:16.494743Z"},"links":{"citing_paper":"/paper/2507.09102"},"observation_digest":"sha256:476234a5c80532ee008947b08d20f1bcc1281937aedcde8e9c380f97c82bbb86","observation_id":"86070a7c-ba84-47f5-a481-b37b26ecd42b","resolution":{"observed_at":"2026-08-06T18:10:18.272034Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T18:10:18.068204Z","title":"Unleashing text-to-image diffu- sion models for visual perception","venue":null,"work_id":"48aef8e9-2266-4e9e-af09-002f5e8672d8","year":2023},"citing_paper":{"arxiv_id":"2507.09102","last_updated":"2025-07-12T01:20:07Z","snapshot_observed_at":"2026-08-06T18:02:05.774630Z","submitted_at":"2025-07-12T01:20:07Z","title":"Harnessing Text-to-Image Diffusion Models for Point Cloud Self-Supervised Learning","version":1},"reference_index":68,"source":"pdf_text","source_observed_at":"2026-08-06T18:10:16.572560Z"},"links":{"citing_paper":"/paper/2507.09102"},"observation_digest":"sha256:3e4b3b49ae09ad98d0af231dbe59d864ef0883b537bac99c9f5a8ad20e5b5b00","observation_id":"369bdf0b-1b69-494d-9cf5-4987af7f5321","resolution":{"observed_at":"2026-08-06T18:10:18.129125Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T18:10:17.922965Z","title":"Point cloud pre-training with diffusion models","venue":null,"work_id":"2246b758-8ec8-4852-9fd2-a75083595ca8","year":2024},"citing_paper":{"arxiv_id":"2507.09102","last_updated":"2025-07-12T01:20:07Z","snapshot_observed_at":"2026-08-06T18:02:05.774630Z","submitted_at":"2025-07-12T01:20:07Z","title":"Harnessing Text-to-Image Diffusion Models for Point Cloud Self-Supervised Learning","version":1},"reference_index":69,"source":"pdf_text","source_observed_at":"2026-08-06T18:10:16.686652Z"},"links":{"citing_paper":"/paper/2507.09102"},"observation_digest":"sha256:c8277897840ea360b1d2db90a9f28743facd63050a59ecc5e7c4683fbf8031b0","observation_id":"99e686ea-f0c3-4f9f-9d28-0e114106b8b5","resolution":{"observed_at":"2026-08-06T18:10:17.986753Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T18:10:17.760789Z","title":"As shown in Tab","venue":null,"work_id":"933f332e-d049-4990-ad59-8047866db2c7","year":null},"citing_paper":{"arxiv_id":"2507.09102","last_updated":"2025-07-12T01:20:07Z","snapshot_observed_at":"2026-08-06T18:02:05.774630Z","submitted_at":"2025-07-12T01:20:07Z","title":"Harnessing Text-to-Image Diffusion Models for Point Cloud Self-Supervised Learning","version":1},"reference_index":70,"source":"pdf_text","source_observed_at":"2026-08-06T18:10:16.758303Z"},"links":{"citing_paper":"/paper/2507.09102"},"observation_digest":"sha256:774aaa3eaf7efd6df1d345fac03395d0338398bbc09d0cfe7f43707d8dea71b3","observation_id":"f5081452-b484-456b-832c-bf82e84b12d6","resolution":{"observed_at":"2026-08-06T18:10:17.807721Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T18:10:17.630471Z","title":null,"venue":null,"work_id":"17f84d1f-763d-43d7-9691-cc1b8a25787f","year":null},"citing_paper":{"arxiv_id":"2507.09102","last_updated":"2025-07-12T01:20:07Z","snapshot_observed_at":"2026-08-06T18:02:05.774630Z","submitted_at":"2025-07-12T01:20:07Z","title":"Harnessing Text-to-Image Diffusion Models for Point Cloud Self-Supervised Learning","version":1},"reference_index":71,"source":"pdf_text","source_observed_at":"2026-08-06T18:10:16.796235Z"},"links":{"citing_paper":"/paper/2507.09102"},"observation_digest":"sha256:edeebe001d31c4d372850e7900b1ed0b23b2c792d6550950cb9872a770b9e853","observation_id":"bf580d36-5f05-48f4-a8a7-5103f5272463","resolution":{"observed_at":"2026-08-06T18:10:17.698514Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T18:10:17.448045Z","title":"Illustration of the Augmentation Strategy.We show our augmentation strategy in Fig","venue":null,"work_id":"cf95a975-65f8-4664-bc32-36a3cd81339c","year":null},"citing_paper":{"arxiv_id":"2507.09102","last_updated":"2025-07-12T01:20:07Z","snapshot_observed_at":"2026-08-06T18:02:05.774630Z","submitted_at":"2025-07-12T01:20:07Z","title":"Harnessing Text-to-Image Diffusion Models for Point Cloud Self-Supervised Learning","version":1},"reference_index":72,"source":"pdf_text","source_observed_at":"2026-08-06T18:10:16.872826Z"},"links":{"citing_paper":"/paper/2507.09102"},"observation_digest":"sha256:90fa33ab156a95ce1cde556caf80bc06d67d147e5867499f2df0342c6fdaf24e","observation_id":"e6796ec5-8155-40c1-9e4a-6e29b44cb2c0","resolution":{"observed_at":"2026-08-06T18:10:17.529897Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}}],"paper":{"arxiv_id":"2507.09102","last_updated":"2025-07-12T01:20:07Z","latest_version":1,"primary_category":"cs.CV","snapshot_observed_at":"2026-08-06T18:02:05.774630Z","submitted_at":"2025-07-12T01:20:07Z","title":"Harnessing Text-to-Image Diffusion Models for Point Cloud Self-Supervised Learning"},"reference_resolution":{"displayed":72,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":24,"verified_exact":1,"verified_fuzzy":47},"total_outbound_references":72},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"thesis":"As of 9 August 2026, this Paper Citation Record lists 72 of 72 outbound references and 0 inbound Pith citation observations for arXiv:2507.09102."}