{"as_of":"2026-08-07T05:19:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:2df66cb2db1f423f1eb5a95a0cec85b432d8ff776501440fe46fedcc855d4572","coverage":[{"denominator":70,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":70,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-05T22:52:02.912049Z","state":"measured"},{"denominator":70,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":70,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-06T06:34:29.942622+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2508.06291/citation-record","integrity":"/paper/2508.06291/integrity","json":"/paper/2508.06291/citation-record.json","paper":"/paper/2508.06291"},"outbound":[{"citation":{"cited_paper":{"arxiv_id":"2105.14257","last_updated":"2024-11-04T03:01:27Z","snapshot_observed_at":"2026-08-06T00:31:00.527257Z","submitted_at":"2021-05-29T09:26:02Z","title":"Diffusion-Based Representation Learning","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2105.14257","snapshot_observed_at":"2026-08-05T22:51:58.625256Z","title":"Abstreiter, S","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2508.06291","last_updated":"2025-08-08T13:11:54Z","snapshot_observed_at":"2026-08-06T19:27:56.147468Z","submitted_at":"2025-08-08T13:11:54Z","title":"Real-Time 3D Vision-Language Embedding Mapping","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-05T22:51:58.625256Z"},"links":{"cited_paper":"/paper/2105.14257","citing_paper":"/paper/2508.06291"},"observation_digest":"sha256:76ddbe92bbf6aa0f2f8cb1438e5d11d3b32d9eb5637a021b90e167bf2347f8fb","observation_id":"05160327-a33a-4783-b10f-a190ec30a1fb","resolution":{"observed_at":"2026-08-05T22:51:58.625256Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":"10.5555/3601993","metadata_source":"doi_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T22:52:03.330831Z","title":"Alayrac, J","venue":null,"work_id":"d4009524-1850-4432-b00a-f313a82f8ae3","year":2022},"citing_paper":{"arxiv_id":"2508.06291","last_updated":"2025-08-08T13:11:54Z","snapshot_observed_at":"2026-08-06T19:27:56.147468Z","submitted_at":"2025-08-08T13:11:54Z","title":"Real-Time 3D Vision-Language Embedding Mapping","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-05T22:51:58.704240Z"},"links":{"citing_paper":"/paper/2508.06291"},"observation_digest":"sha256:98137873581c3fc35c9c02a33855d4a31d14a276b1f0b6263933e0927ba15296","observation_id":"528fafec-561a-40c6-ad3e-35640d1e1379","resolution":{"observed_at":"2026-08-05T22:52:03.335006Z","resolver_source":"doi","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2406.00505","last_updated":"2024-10-23T08:28:53Z","snapshot_observed_at":"2026-07-06T18:23:48.473551Z","submitted_at":"2024-06-01T17:27:34Z","title":"Improving Text Generation on Images with Synthetic Captions","version":2},"cited_work":{"arxiv_id":"2406.00505","doi":"10.48550/arxiv.2406.00505","metadata_source":"pith","pith_arxiv_id":"2406.00505","snapshot_observed_at":"2026-08-06T00:16:16.768632Z","title":"Improving Text Generation on Images with Synthetic Captions","venue":"cs.CV","work_id":"0bf7ed8b-ac98-4db1-af29-11b56b2cf6ef","year":2024},"citing_paper":{"arxiv_id":"2508.06291","last_updated":"2025-08-08T13:11:54Z","snapshot_observed_at":"2026-08-06T19:27:56.147468Z","submitted_at":"2025-08-08T13:11:54Z","title":"Real-Time 3D Vision-Language Embedding Mapping","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-05T22:51:58.783693Z"},"links":{"cited_paper":"/paper/2406.00505","citing_paper":"/paper/2508.06291"},"observation_digest":"sha256:11295732eadda664d19bd8d8e715b9441e4c18122187e1119517b85814e1e9aa","observation_id":"a5ebf267-1979-4102-aafc-479f72b9dc79","resolution":{"observed_at":"2026-08-05T22:52:03.321025Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":"10.1007/b100265","metadata_source":"doi_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T22:52:03.297069Z","title":null,"venue":null,"work_id":"3b949b70-e633-464a-b50c-b696405fa69c","year":2004},"citing_paper":{"arxiv_id":"2508.06291","last_updated":"2025-08-08T13:11:54Z","snapshot_observed_at":"2026-08-06T19:27:56.147468Z","submitted_at":"2025-08-08T13:11:54Z","title":"Real-Time 3D Vision-Language Embedding Mapping","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-05T22:51:58.888198Z"},"links":{"citing_paper":"/paper/2508.06291"},"observation_digest":"sha256:8044af69027c6c732c325ec52c5014efabce0ffd1b822b39b2484ba7e613d4e9","observation_id":"405e3441-b98c-4ebd-a539-e2e10e5bb9c6","resolution":{"observed_at":"2026-08-05T22:52:03.301563Z","resolver_source":"doi","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2401.14404","last_updated":"2024-01-25T18:59:57Z","snapshot_observed_at":"2026-08-06T14:37:40.501908Z","submitted_at":"2024-01-25T18:59:57Z","title":"Deconstructing Denoising Diffusion Models for Self-Supervised Learning","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2401.14404","snapshot_observed_at":"2026-08-05T22:51:58.987307Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2508.06291","last_updated":"2025-08-08T13:11:54Z","snapshot_observed_at":"2026-08-06T19:27:56.147468Z","submitted_at":"2025-08-08T13:11:54Z","title":"Real-Time 3D Vision-Language Embedding Mapping","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-05T22:51:58.987307Z"},"links":{"cited_paper":"/paper/2401.14404","citing_paper":"/paper/2508.06291"},"observation_digest":"sha256:a15bcb71ce022274913ab03dfeafb9eb1f0ef7cc9268db937080d3b59f94f56a","observation_id":"095642e9-b2f5-47e8-8e79-ec96c9570365","resolution":{"observed_at":"2026-08-05T22:51:58.987307Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T22:51:59.235840Z","title":null,"venue":null,"work_id":null,"year":2007},"citing_paper":{"arxiv_id":"2508.06291","last_updated":"2025-08-08T13:11:54Z","snapshot_observed_at":"2026-08-06T19:27:56.147468Z","submitted_at":"2025-08-08T13:11:54Z","title":"Real-Time 3D Vision-Language Embedding Mapping","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-05T22:51:59.235840Z"},"links":{"citing_paper":"/paper/2508.06291"},"observation_digest":"sha256:c0257010f5bdaa4ffb99f27406262eddf75b770736e11d6500b3cc9df860d796","observation_id":"5f8322b3-0eee-4d2a-bc12-df9b956183fd","resolution":{"observed_at":"2026-08-05T22:51:59.235840Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2305.06500","last_updated":"2023-06-15T08:00:18Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2023-05-11T00:38:10Z","title":"InstructBLIP: Towards General-purpose Vision-Language Models with Instruction Tuning","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2305.06500","snapshot_observed_at":"2026-08-05T22:51:59.363572Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2508.06291","last_updated":"2025-08-08T13:11:54Z","snapshot_observed_at":"2026-08-06T19:27:56.147468Z","submitted_at":"2025-08-08T13:11:54Z","title":"Real-Time 3D Vision-Language Embedding Mapping","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-05T22:51:59.363572Z"},"links":{"cited_paper":"/paper/2305.06500","citing_paper":"/paper/2508.06291"},"observation_digest":"sha256:a11749bc154fdca6a2900792e07fe3a420499bc40314ed94390643d98339e4d5","observation_id":"d2729ab0-bd8a-4b7b-8746-e419a18da89f","resolution":{"observed_at":"2026-08-05T22:51:59.363572Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"5171.30252","doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T22:52:05.379611Z","title":"Dhamdhere, K","venue":null,"work_id":"4ce11b02-a3d7-429d-a568-aabd68639db7","year":2017},"citing_paper":{"arxiv_id":"2508.06291","last_updated":"2025-08-08T13:11:54Z","snapshot_observed_at":"2026-08-06T19:27:56.147468Z","submitted_at":"2025-08-08T13:11:54Z","title":"Real-Time 3D Vision-Language Embedding Mapping","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-05T22:51:59.459803Z"},"links":{"citing_paper":"/paper/2508.06291"},"observation_digest":"sha256:5800ed8b666576e945d40da297e29f294f1befa7f938847c7c41f0646cd7eef8","observation_id":"f6d78abc-9b57-40ed-b722-1a7926081c45","resolution":{"observed_at":"2026-08-05T22:52:05.386012Z","resolver_source":"raw_fallback","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2407.21783","last_updated":"2024-11-23T23:27:33Z","snapshot_observed_at":"2026-07-06T18:55:11.576666Z","submitted_at":"2024-07-31T17:54:27Z","title":"The Llama 3 Herd of Models","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2407.21783","snapshot_observed_at":"2026-08-05T22:51:59.555067Z","title":"Dubey, A","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2508.06291","last_updated":"2025-08-08T13:11:54Z","snapshot_observed_at":"2026-08-06T19:27:56.147468Z","submitted_at":"2025-08-08T13:11:54Z","title":"Real-Time 3D Vision-Language Embedding Mapping","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-05T22:51:59.555067Z"},"links":{"cited_paper":"/paper/2407.21783","citing_paper":"/paper/2508.06291"},"observation_digest":"sha256:c4473b18a04707253f937adc2a3023b03f6ba74a9ee1f375aa37c28c53878379","observation_id":"586b3d61-0d1d-4049-9570-f0ee51f06620","resolution":{"observed_at":"2026-08-05T22:51:59.555067Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T22:52:05.549293Z","title":null,"venue":null,"work_id":"8b46c63f-94cd-4b45-9278-7152a5dbe6df","year":null},"citing_paper":{"arxiv_id":"2508.06291","last_updated":"2025-08-08T13:11:54Z","snapshot_observed_at":"2026-08-06T19:27:56.147468Z","submitted_at":"2025-08-08T13:11:54Z","title":"Real-Time 3D Vision-Language Embedding Mapping","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-05T22:51:59.668520Z"},"links":{"citing_paper":"/paper/2508.06291"},"observation_digest":"sha256:402e33d4a730326b00626dc0b046b29314467f4c3572f03d41fb04205bd61650","observation_id":"384c9425-441d-4b3d-b70b-fc4608192576","resolution":{"observed_at":"2026-08-05T22:52:05.553561Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2006.11239","last_updated":"2020-12-16T21:15:05Z","snapshot_observed_at":"2026-07-06T09:30:47.469703Z","submitted_at":"2020-06-19T17:24:44Z","title":"Denoising Diffusion Probabilistic Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2006.11239","snapshot_observed_at":"2026-08-05T22:51:59.876708Z","title":null,"venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2508.06291","last_updated":"2025-08-08T13:11:54Z","snapshot_observed_at":"2026-08-06T19:27:56.147468Z","submitted_at":"2025-08-08T13:11:54Z","title":"Real-Time 3D Vision-Language Embedding Mapping","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-05T22:51:59.876708Z"},"links":{"cited_paper":"/paper/2006.11239","citing_paper":"/paper/2508.06291"},"observation_digest":"sha256:1083017500e30446dd06eec56154a9036a2aaa0d4e3e3fa707036304c74e361d","observation_id":"191deeac-e5bd-4e53-b92f-0fea7a6bfd05","resolution":{"observed_at":"2026-08-05T22:51:59.876708Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T22:51:59.968188Z","title":"Hoque, V","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2508.06291","last_updated":"2025-08-08T13:11:54Z","snapshot_observed_at":"2026-08-06T19:27:56.147468Z","submitted_at":"2025-08-08T13:11:54Z","title":"Real-Time 3D Vision-Language Embedding Mapping","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-05T22:51:59.968188Z"},"links":{"citing_paper":"/paper/2508.06291"},"observation_digest":"sha256:2e36b0e826f89e1ea9c052618a2a206db8ee4801c0433df932d50b3b0bfe1def","observation_id":"2d5b0fd4-b969-4c65-8e8c-7a3f9ad8b5e5","resolution":{"observed_at":"2026-08-05T22:51:59.968188Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T22:52:00.071974Z","title":"Huang, Y","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2508.06291","last_updated":"2025-08-08T13:11:54Z","snapshot_observed_at":"2026-08-06T19:27:56.147468Z","submitted_at":"2025-08-08T13:11:54Z","title":"Real-Time 3D Vision-Language Embedding Mapping","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-05T22:52:00.071974Z"},"links":{"citing_paper":"/paper/2508.06291"},"observation_digest":"sha256:221b5bf34a699cd8c52f146926c5fadc8c45791fe9fc1bd20b9bcdab518a1bbb","observation_id":"e9814b17-8781-4d5a-a2d5-9298c85351ed","resolution":{"observed_at":"2026-08-05T22:52:00.071974Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":"10.1109/tvcg.2013.121","metadata_source":"doi_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T22:52:03.217331Z","title":"Jackson, T","venue":null,"work_id":"3b2f4a9e-8b3c-432a-9501-0349ad25fdb3","year":2013},"citing_paper":{"arxiv_id":"2508.06291","last_updated":"2025-08-08T13:11:54Z","snapshot_observed_at":"2026-08-06T19:27:56.147468Z","submitted_at":"2025-08-08T13:11:54Z","title":"Real-Time 3D Vision-Language Embedding Mapping","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-05T22:52:00.146771Z"},"links":{"citing_paper":"/paper/2508.06291"},"observation_digest":"sha256:80945aeb5f95f9cf9023a78a82a166d4122e064f49fe8bba1b09ea1e335c47f5","observation_id":"bbda9b38-8b99-4ccd-96f4-beb8a42797a5","resolution":{"observed_at":"2026-08-05T22:52:03.221199Z","resolver_source":"doi","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T22:52:05.536181Z","title":"Jobard and W","venue":null,"work_id":"91ffc0c5-9653-403a-b17a-18249d2ca53b","year":1997},"citing_paper":{"arxiv_id":"2508.06291","last_updated":"2025-08-08T13:11:54Z","snapshot_observed_at":"2026-08-06T19:27:56.147468Z","submitted_at":"2025-08-08T13:11:54Z","title":"Real-Time 3D Vision-Language Embedding Mapping","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-05T22:52:00.253577Z"},"links":{"citing_paper":"/paper/2508.06291"},"observation_digest":"sha256:b62097e8a17565b5a28fab656319a1653d21267ebc9072d86f80be4181664dee","observation_id":"a3901f68-3e02-46c5-bc5f-3962a3509379","resolution":{"observed_at":"2026-08-05T22:52:05.540123Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T22:52:00.353944Z","title":"Karras, M","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2508.06291","last_updated":"2025-08-08T13:11:54Z","snapshot_observed_at":"2026-08-06T19:27:56.147468Z","submitted_at":"2025-08-08T13:11:54Z","title":"Real-Time 3D Vision-Language Embedding Mapping","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-05T22:52:00.353944Z"},"links":{"citing_paper":"/paper/2508.06291"},"observation_digest":"sha256:f4b3379854bb59884407e8f062c3ff302690d58dfa815d5e589dfbdb63f82e47","observation_id":"41c945ca-1402-4f4b-b2b2-a0cd711386c9","resolution":{"observed_at":"2026-08-05T22:52:00.353944Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":"10.18653/v1/w16-3639","metadata_source":"doi_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T22:52:03.194797Z","title":"Kumar, J","venue":null,"work_id":"f53d70e0-9931-4179-964e-3ba7f368dadc","year":2016},"citing_paper":{"arxiv_id":"2508.06291","last_updated":"2025-08-08T13:11:54Z","snapshot_observed_at":"2026-08-06T19:27:56.147468Z","submitted_at":"2025-08-08T13:11:54Z","title":"Real-Time 3D Vision-Language Embedding Mapping","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-05T22:52:00.547660Z"},"links":{"citing_paper":"/paper/2508.06291"},"observation_digest":"sha256:5cce8c3d52cafdcb441b78a4e2478d4c63c4f7e0eb7afb5d3412742e6186b902","observation_id":"ccef9bf5-a6dd-4dc4-a3b4-e82989fb02fa","resolution":{"observed_at":"2026-08-05T22:52:03.198690Z","resolver_source":"doi","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T22:52:05.522578Z","title":"Lacasa, B","venue":null,"work_id":"ed918c1e-4786-49f2-93f8-7cbc2d74fabe","year":2008},"citing_paper":{"arxiv_id":"2508.06291","last_updated":"2025-08-08T13:11:54Z","snapshot_observed_at":"2026-08-06T19:27:56.147468Z","submitted_at":"2025-08-08T13:11:54Z","title":"Real-Time 3D Vision-Language Embedding Mapping","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-05T22:52:00.685289Z"},"links":{"citing_paper":"/paper/2508.06291"},"observation_digest":"sha256:817c71ebeb4c6c1a2f0286304be29a858820f3700c3b20b3dc05ff6a0facf714","observation_id":"99f42bb9-a176-4b28-b9e2-4f389960c3bf","resolution":{"observed_at":"2026-08-05T22:52:05.526526Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T22:52:00.805190Z","title":null,"venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2508.06291","last_updated":"2025-08-08T13:11:54Z","snapshot_observed_at":"2026-08-06T19:27:56.147468Z","submitted_at":"2025-08-08T13:11:54Z","title":"Real-Time 3D Vision-Language Embedding Mapping","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-05T22:52:00.805190Z"},"links":{"citing_paper":"/paper/2508.06291"},"observation_digest":"sha256:834f0c526ae5e3f400aa6352c8c44719feba9243494d15e3d51417e36cb38c97","observation_id":"96f45a4d-05f7-4ca4-9d51-478ace4c45db","resolution":{"observed_at":"2026-08-05T22:52:00.805190Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T22:52:00.905495Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2508.06291","last_updated":"2025-08-08T13:11:54Z","snapshot_observed_at":"2026-08-06T19:27:56.147468Z","submitted_at":"2025-08-08T13:11:54Z","title":"Real-Time 3D Vision-Language Embedding Mapping","version":1},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-05T22:52:00.905495Z"},"links":{"citing_paper":"/paper/2508.06291"},"observation_digest":"sha256:f90625b42586ffade1833f0704adfe1521707cb9cee7a2e4ae3d6b7b5ce8619b","observation_id":"80f35b83-be4a-44e4-844d-112d0a4fa595","resolution":{"observed_at":"2026-08-05T22:52:00.905495Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"8454.36184","doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T22:52:04.994407Z","title":null,"venue":null,"work_id":"37eb9c20-eeff-4613-a70c-ee1f99f5c2b6","year":2022},"citing_paper":{"arxiv_id":"2508.06291","last_updated":"2025-08-08T13:11:54Z","snapshot_observed_at":"2026-08-06T19:27:56.147468Z","submitted_at":"2025-08-08T13:11:54Z","title":"Real-Time 3D Vision-Language Embedding Mapping","version":1},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-05T22:52:00.999791Z"},"links":{"citing_paper":"/paper/2508.06291"},"observation_digest":"sha256:4a451bc0305894acc3fe795ae3df93c0ed5264e26b000fc2edb6b1291f0f3cfb","observation_id":"5c637c6e-80db-439e-a9fb-7f20167fed60","resolution":{"observed_at":"2026-08-05T22:52:05.001505Z","resolver_source":"raw_fallback","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2406.11838","last_updated":"2024-11-01T14:45:36Z","snapshot_observed_at":"2026-07-06T18:32:23.999019Z","submitted_at":"2024-06-17T17:59:58Z","title":"Autoregressive Image Generation without Vector Quantization","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2406.11838","snapshot_observed_at":"2026-08-05T22:52:01.107998Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2508.06291","last_updated":"2025-08-08T13:11:54Z","snapshot_observed_at":"2026-08-06T19:27:56.147468Z","submitted_at":"2025-08-08T13:11:54Z","title":"Real-Time 3D Vision-Language Embedding Mapping","version":1},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-05T22:52:01.107998Z"},"links":{"cited_paper":"/paper/2406.11838","citing_paper":"/paper/2508.06291"},"observation_digest":"sha256:ca9b340e46a0f287191aa4c3690f9af6f2f8d3c3a8814bd4b756ae755e42e150","observation_id":"3e59b044-fbeb-49a9-a081-fc883f151de8","resolution":{"observed_at":"2026-08-05T22:52:01.107998Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":"10.1117/12.2038253","metadata_source":"doi_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T22:52:03.157132Z","title":null,"venue":null,"work_id":"f0a09abe-0cec-4d10-a057-61121042e8c3","year":2014},"citing_paper":{"arxiv_id":"2508.06291","last_updated":"2025-08-08T13:11:54Z","snapshot_observed_at":"2026-08-06T19:27:56.147468Z","submitted_at":"2025-08-08T13:11:54Z","title":"Real-Time 3D Vision-Language Embedding Mapping","version":1},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-05T22:52:01.210300Z"},"links":{"citing_paper":"/paper/2508.06291"},"observation_digest":"sha256:3340984782ccab4851d41a621670223eb40c5a2b4f63605699bb0a32775c611f","observation_id":"56242c7d-ad25-471c-a5ee-a866c0997b65","resolution":{"observed_at":"2026-08-05T22:52:03.161506Z","resolver_source":"doi","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T22:52:01.353603Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2508.06291","last_updated":"2025-08-08T13:11:54Z","snapshot_observed_at":"2026-08-06T19:27:56.147468Z","submitted_at":"2025-08-08T13:11:54Z","title":"Real-Time 3D Vision-Language Embedding Mapping","version":1},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-05T22:52:01.353603Z"},"links":{"citing_paper":"/paper/2508.06291"},"observation_digest":"sha256:25daa1e74cca2c35e4ddc045d6b445d943f8291f16aeec1d83fd5fcea00f4ab2","observation_id":"c69fd755-8c84-48f4-a036-0c6c24d7900b","resolution":{"observed_at":"2026-08-05T22:52:01.353603Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2304.08485","last_updated":"2023-12-11T17:46:14Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2023-04-17T17:59:25Z","title":"Visual Instruction Tuning","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2304.08485","snapshot_observed_at":"2026-08-05T22:52:01.417142Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2508.06291","last_updated":"2025-08-08T13:11:54Z","snapshot_observed_at":"2026-08-06T19:27:56.147468Z","submitted_at":"2025-08-08T13:11:54Z","title":"Real-Time 3D Vision-Language Embedding Mapping","version":1},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-08-05T22:52:01.417142Z"},"links":{"cited_paper":"/paper/2304.08485","citing_paper":"/paper/2508.06291"},"observation_digest":"sha256:986a175e1276b3abcc8b80a9827633b400a86bb4e17cb33a9c0abc53d3464ba5","observation_id":"2140f980-9d52-4632-9c65-6f93faba483d","resolution":{"observed_at":"2026-08-05T22:52:01.417142Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T22:52:01.501056Z","title":null,"venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2508.06291","last_updated":"2025-08-08T13:11:54Z","snapshot_observed_at":"2026-08-06T19:27:56.147468Z","submitted_at":"2025-08-08T13:11:54Z","title":"Real-Time 3D Vision-Language Embedding Mapping","version":1},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-08-05T22:52:01.501056Z"},"links":{"citing_paper":"/paper/2508.06291"},"observation_digest":"sha256:6de277ce395904db1bbbae7ead8f9af9124280009a691c33391205624b7de316","observation_id":"a1c1e0ec-d4bf-4d36-95af-47374481f3af","resolution":{"observed_at":"2026-08-05T22:52:01.501056Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T22:52:01.616863Z","title":null,"venue":null,"work_id":null,"year":2013},"citing_paper":{"arxiv_id":"2508.06291","last_updated":"2025-08-08T13:11:54Z","snapshot_observed_at":"2026-08-06T19:27:56.147468Z","submitted_at":"2025-08-08T13:11:54Z","title":"Real-Time 3D Vision-Language Embedding Mapping","version":1},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-08-05T22:52:01.616863Z"},"links":{"citing_paper":"/paper/2508.06291"},"observation_digest":"sha256:8ff4c978a5404c22d9db8bf20fa31aeecd7356f0e02df73994a9f01c4435a2d0","observation_id":"f6fb4dbe-605e-43ef-86bb-9e232a0efbc8","resolution":{"observed_at":"2026-08-05T22:52:01.616863Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T22:52:01.689428Z","title":null,"venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2508.06291","last_updated":"2025-08-08T13:11:54Z","snapshot_observed_at":"2026-08-06T19:27:56.147468Z","submitted_at":"2025-08-08T13:11:54Z","title":"Real-Time 3D Vision-Language Embedding Mapping","version":1},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-08-05T22:52:01.689428Z"},"links":{"citing_paper":"/paper/2508.06291"},"observation_digest":"sha256:35921c984986cf3907dc7c1550c4c56414bac5b54b92675f8433e939974a6ab6","observation_id":"0d1e28cb-6e52-4225-9e32-3b5903657c14","resolution":{"observed_at":"2026-08-05T22:52:01.689428Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":"10.1109/tvcg.2012.150","metadata_source":"doi_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T22:52:03.128480Z","title":"McLoughlin, M","venue":null,"work_id":"e6ec980b-925b-412b-98b2-d9ffb31d5ab5","year":2013},"citing_paper":{"arxiv_id":"2508.06291","last_updated":"2025-08-08T13:11:54Z","snapshot_observed_at":"2026-08-06T19:27:56.147468Z","submitted_at":"2025-08-08T13:11:54Z","title":"Real-Time 3D Vision-Language Embedding Mapping","version":1},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-08-05T22:52:01.849421Z"},"links":{"citing_paper":"/paper/2508.06291"},"observation_digest":"sha256:86730fd1e429244548e48d269a99543bfeb254ce84885a33fd30ad6692ffc15b","observation_id":"f000941a-ce62-4205-944a-c0b045726404","resolution":{"observed_at":"2026-08-05T22:52:03.132593Z","resolver_source":"doi","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T22:52:01.951397Z","title":"McLoughlin, R","venue":null,"work_id":null,"year":2010},"citing_paper":{"arxiv_id":"2508.06291","last_updated":"2025-08-08T13:11:54Z","snapshot_observed_at":"2026-08-06T19:27:56.147468Z","submitted_at":"2025-08-08T13:11:54Z","title":"Real-Time 3D Vision-Language Embedding Mapping","version":1},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-08-05T22:52:01.951397Z"},"links":{"citing_paper":"/paper/2508.06291"},"observation_digest":"sha256:31a67d78dad668a54d54fe499464fbfc83f5735e67660d36721d9f171c976576","observation_id":"a1938fa8-bfc7-4db3-86e7-ed6e237db82c","resolution":{"observed_at":"2026-08-05T22:52:01.951397Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2210.13774","last_updated":"2022-10-25T05:30:53Z","snapshot_observed_at":"2026-08-03T01:05:02.758230Z","submitted_at":"2022-10-25T05:30:53Z","title":"From Points to Functions: Infinite-dimensional Representations in Diffusion Models","version":1},"cited_work":{"arxiv_id":"2210.13774","doi":"10.48550/arxiv.2210.13774","metadata_source":"pith","pith_arxiv_id":"2210.13774","snapshot_observed_at":"2026-08-06T00:16:16.768632Z","title":"From Points to Functions: Infinite-dimensional Representations in Diffusion Models","venue":"cs.LG","work_id":"c234da30-6195-4856-bac6-d76cc4fc727d","year":2022},"citing_paper":{"arxiv_id":"2508.06291","last_updated":"2025-08-08T13:11:54Z","snapshot_observed_at":"2026-08-06T19:27:56.147468Z","submitted_at":"2025-08-08T13:11:54Z","title":"Real-Time 3D Vision-Language Embedding Mapping","version":1},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-08-05T22:52:02.066914Z"},"links":{"cited_paper":"/paper/2210.13774","citing_paper":"/paper/2508.06291"},"observation_digest":"sha256:2bede6737875b4093602a1f3232cd2477f3042add606da09d12bee4917627161","observation_id":"085d0d8d-9812-4b0f-b682-e8f1ef62ef4c","resolution":{"observed_at":"2026-08-05T22:52:03.118791Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T22:52:02.173419Z","title":"Narechania, A","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2508.06291","last_updated":"2025-08-08T13:11:54Z","snapshot_observed_at":"2026-08-06T19:27:56.147468Z","submitted_at":"2025-08-08T13:11:54Z","title":"Real-Time 3D Vision-Language Embedding Mapping","version":1},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-08-05T22:52:02.173419Z"},"links":{"citing_paper":"/paper/2508.06291"},"observation_digest":"sha256:9f025746430c8cf0ee0084ffab62d48b1b26118428d533a590eeea3ce4baf946","observation_id":"5dd6ef62-ae4d-4fcc-acf2-48508865bc24","resolution":{"observed_at":"2026-08-05T22:52:02.173419Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"2013.22979","doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T22:52:04.457892Z","title":"Oeltze, D","venue":null,"work_id":"f532ea46-40a6-4a6b-bb3b-9adcba240197","year":2014},"citing_paper":{"arxiv_id":"2508.06291","last_updated":"2025-08-08T13:11:54Z","snapshot_observed_at":"2026-08-06T19:27:56.147468Z","submitted_at":"2025-08-08T13:11:54Z","title":"Real-Time 3D Vision-Language Embedding Mapping","version":1},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-08-05T22:52:02.327673Z"},"links":{"citing_paper":"/paper/2508.06291"},"observation_digest":"sha256:bf866780432278c3ce24731179283f65cedcbefa8e3e6dfd8f327c63137e9866","observation_id":"c96a55a8-0e9f-4235-b575-011f874f7f90","resolution":{"observed_at":"2026-08-05T22:52:04.464559Z","resolver_source":"raw_fallback","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"1647.57164","doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T22:52:04.363693Z","title":"Osada, T","venue":null,"work_id":"8726dcc4-df6d-4d71-90b1-71661680b712","year":2002},"citing_paper":{"arxiv_id":"2508.06291","last_updated":"2025-08-08T13:11:54Z","snapshot_observed_at":"2026-08-06T19:27:56.147468Z","submitted_at":"2025-08-08T13:11:54Z","title":"Real-Time 3D Vision-Language Embedding Mapping","version":1},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-08-05T22:52:02.447309Z"},"links":{"citing_paper":"/paper/2508.06291"},"observation_digest":"sha256:97d74a3bd8746f90cf7fc80cba4d2fc5a01e4227a1ddf2d3f264be6fceed3802","observation_id":"4081bd70-8287-452e-b63c-3986c4659b3c","resolution":{"observed_at":"2026-08-05T22:52:04.370108Z","resolver_source":"raw_fallback","status":"malformed_identifier"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T22:52:02.527294Z","title":"Preechakul, N","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2508.06291","last_updated":"2025-08-08T13:11:54Z","snapshot_observed_at":"2026-08-06T19:27:56.147468Z","submitted_at":"2025-08-08T13:11:54Z","title":"Real-Time 3D Vision-Language Embedding Mapping","version":1},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-08-05T22:52:02.527294Z"},"links":{"citing_paper":"/paper/2508.06291"},"observation_digest":"sha256:fa52f31a2e922b5cc804d7046eb2b6cda451cb15b826fa79c53366765111d44d","observation_id":"9ba9603a-a7d3-45cb-8ae6-1ede230d6b9c","resolution":{"observed_at":"2026-08-05T22:52:02.527294Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2102.12092","last_updated":"2021-02-26T23:26:05Z","snapshot_observed_at":"2026-07-06T10:44:09.403787Z","submitted_at":"2021-02-24T06:42:31Z","title":"Zero-Shot Text-to-Image Generation","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2102.12092","snapshot_observed_at":"2026-08-05T22:52:02.653418Z","title":"Ramesh, M","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2508.06291","last_updated":"2025-08-08T13:11:54Z","snapshot_observed_at":"2026-08-06T19:27:56.147468Z","submitted_at":"2025-08-08T13:11:54Z","title":"Real-Time 3D Vision-Language Embedding Mapping","version":1},"reference_index":36,"source":"pdf_text","source_observed_at":"2026-08-05T22:52:02.653418Z"},"links":{"cited_paper":"/paper/2102.12092","citing_paper":"/paper/2508.06291"},"observation_digest":"sha256:993eb0223a692023d4954e7978910a7a8e27d55e1e48b36e436cbc8e618e4a83","observation_id":"725a87a1-2138-4c38-93a8-61406a50411f","resolution":{"observed_at":"2026-08-05T22:52:02.653418Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T22:52:05.509360Z","title":"Reimers and I","venue":null,"work_id":"3e203ac9-3148-41ab-b61e-e16f1b4ba76e","year":2019},"citing_paper":{"arxiv_id":"2508.06291","last_updated":"2025-08-08T13:11:54Z","snapshot_observed_at":"2026-08-06T19:27:56.147468Z","submitted_at":"2025-08-08T13:11:54Z","title":"Real-Time 3D Vision-Language Embedding Mapping","version":1},"reference_index":37,"source":"pdf_text","source_observed_at":"2026-08-05T22:52:02.779373Z"},"links":{"citing_paper":"/paper/2508.06291"},"observation_digest":"sha256:b5888ff2d19c53c2eb70dcaf4deba559253f6629d80113d8516cdeb54acfc3b3","observation_id":"c91733de-06e0-4320-85f5-8fea233d4b82","resolution":{"observed_at":"2026-08-05T22:52:05.513488Z","resolver_source":"raw_fallback","status":"malformed_identifier"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T22:52:02.791111Z","title":"R¨ossl and H","venue":null,"work_id":null,"year":2012},"citing_paper":{"arxiv_id":"2508.06291","last_updated":"2025-08-08T13:11:54Z","snapshot_observed_at":"2026-08-06T19:27:56.147468Z","submitted_at":"2025-08-08T13:11:54Z","title":"Real-Time 3D Vision-Language Embedding Mapping","version":1},"reference_index":38,"source":"pdf_text","source_observed_at":"2026-08-05T22:52:02.791111Z"},"links":{"citing_paper":"/paper/2508.06291"},"observation_digest":"sha256:54d2430eb0a356ac76b79dd1fe0ae592bdacd3e84b6f6b0b4e68e543df5b2fe1","observation_id":"bcf0b40d-9797-47b9-b0bb-a36cd8b10563","resolution":{"observed_at":"2026-08-05T22:52:02.791111Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T22:52:02.795484Z","title":"Sadlo, R","venue":null,"work_id":null,"year":2004},"citing_paper":{"arxiv_id":"2508.06291","last_updated":"2025-08-08T13:11:54Z","snapshot_observed_at":"2026-08-06T19:27:56.147468Z","submitted_at":"2025-08-08T13:11:54Z","title":"Real-Time 3D Vision-Language Embedding Mapping","version":1},"reference_index":39,"source":"pdf_text","source_observed_at":"2026-08-05T22:52:02.795484Z"},"links":{"citing_paper":"/paper/2508.06291"},"observation_digest":"sha256:015bc05063c509f22fb7ccc5035d3bd7bcabfa0ab4097bdd8383d4672130ee61","observation_id":"0f2ad04e-61c7-4394-b4d8-2f23bcd68b88","resolution":{"observed_at":"2026-08-05T22:52:02.795484Z","resolver_source":null,"status":"malformed_identifier"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":"10.1109/tvcg.2006.104","metadata_source":"doi_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T22:52:03.060649Z","title":"Salzbrunn and G","venue":null,"work_id":"b22ada2d-e502-4d85-9d30-f65b46faaed6","year":2006},"citing_paper":{"arxiv_id":"2508.06291","last_updated":"2025-08-08T13:11:54Z","snapshot_observed_at":"2026-08-06T19:27:56.147468Z","submitted_at":"2025-08-08T13:11:54Z","title":"Real-Time 3D Vision-Language Embedding Mapping","version":1},"reference_index":40,"source":"pdf_text","source_observed_at":"2026-08-05T22:52:02.799589Z"},"links":{"citing_paper":"/paper/2508.06291"},"observation_digest":"sha256:60bc4b6722a42807a6bb75cfa027ac671f1d5ca00b6b2c1701e3e70e44a90d88","observation_id":"37f57a0c-f707-403c-956f-9ba50e1a8b54","resolution":{"observed_at":"2026-08-05T22:52:03.065560Z","resolver_source":"doi","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T22:52:05.493954Z","title":"Setlur, S","venue":null,"work_id":"adede44b-b50e-4fc4-82f5-3c6470f1586c","year":null},"citing_paper":{"arxiv_id":"2508.06291","last_updated":"2025-08-08T13:11:54Z","snapshot_observed_at":"2026-08-06T19:27:56.147468Z","submitted_at":"2025-08-08T13:11:54Z","title":"Real-Time 3D Vision-Language Embedding Mapping","version":1},"reference_index":41,"source":"pdf_text","source_observed_at":"2026-08-05T22:52:02.803584Z"},"links":{"citing_paper":"/paper/2508.06291"},"observation_digest":"sha256:6fd421c4cfb874c1b50c98b839048bbe633c1bce4b735ed6607a0301c9bd91d8","observation_id":"9176a6be-f1ff-4890-888d-78b6e7a4126e","resolution":{"observed_at":"2026-08-05T22:52:05.499273Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T22:52:05.479916Z","title":null,"venue":null,"work_id":"e2132722-45ae-4c93-b7cc-8f19c23d5628","year":2009},"citing_paper":{"arxiv_id":"2508.06291","last_updated":"2025-08-08T13:11:54Z","snapshot_observed_at":"2026-08-06T19:27:56.147468Z","submitted_at":"2025-08-08T13:11:54Z","title":"Real-Time 3D Vision-Language Embedding Mapping","version":1},"reference_index":42,"source":"pdf_text","source_observed_at":"2026-08-05T22:52:02.812575Z"},"links":{"citing_paper":"/paper/2508.06291"},"observation_digest":"sha256:2df9dc6f3aa97799bfa73fc2c7154565ab654b89746c5ddbe53a6d75fc01bf45","observation_id":"5433ea31-8052-4d36-9d1f-7e0fc66636c4","resolution":{"observed_at":"2026-08-05T22:52:05.483836Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2011.13456","last_updated":"2021-02-10T18:17:04Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2020-11-26T19:39:10Z","title":"Score-Based Generative Modeling through Stochastic Differential Equations","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2011.13456","snapshot_observed_at":"2026-08-05T22:52:02.816447Z","title":null,"venue":null,"work_id":null,"year":2011},"citing_paper":{"arxiv_id":"2508.06291","last_updated":"2025-08-08T13:11:54Z","snapshot_observed_at":"2026-08-06T19:27:56.147468Z","submitted_at":"2025-08-08T13:11:54Z","title":"Real-Time 3D Vision-Language Embedding Mapping","version":1},"reference_index":43,"source":"pdf_text","source_observed_at":"2026-08-05T22:52:02.816447Z"},"links":{"cited_paper":"/paper/2011.13456","citing_paper":"/paper/2508.06291"},"observation_digest":"sha256:e079af911dbc9c705eadd9466f9715355bd40cf518cdae1b726d507fac488769","observation_id":"3325b041-c60c-482b-ab5b-f9350b7ee4ad","resolution":{"observed_at":"2026-08-05T22:52:02.816447Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":"10.1007/978-3-642-13544-6","metadata_source":"openalex","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T11:07:33.414567Z","title":null,"venue":"Lecture notes in computer science","work_id":"5f9d3e68-ab51-464a-8bad-363ec13f6a9c","year":2010},"citing_paper":{"arxiv_id":"2508.06291","last_updated":"2025-08-08T13:11:54Z","snapshot_observed_at":"2026-08-06T19:27:56.147468Z","submitted_at":"2025-08-08T13:11:54Z","title":"Real-Time 3D Vision-Language Embedding Mapping","version":1},"reference_index":44,"source":"pdf_text","source_observed_at":"2026-08-05T22:52:02.820860Z"},"links":{"citing_paper":"/paper/2508.06291"},"observation_digest":"sha256:ff8feca02a169de6d1d5070ce7e7832b6c798427130ddc0182be2c7429991c40","observation_id":"67b38167-65a6-42f6-b9a2-8be62c787774","resolution":{"observed_at":"2026-08-05T22:52:03.036679Z","resolver_source":"doi","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T22:52:02.824935Z","title":null,"venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2508.06291","last_updated":"2025-08-08T13:11:54Z","snapshot_observed_at":"2026-08-06T19:27:56.147468Z","submitted_at":"2025-08-08T13:11:54Z","title":"Real-Time 3D Vision-Language Embedding Mapping","version":1},"reference_index":45,"source":"pdf_text","source_observed_at":"2026-08-05T22:52:02.824935Z"},"links":{"citing_paper":"/paper/2508.06291"},"observation_digest":"sha256:a7b85602b69a2160932b30677f2a625824e86895826e848f5a68a4bd411dd124","observation_id":"74e4acae-4cf2-471c-93de-339eeb6fcd87","resolution":{"observed_at":"2026-08-05T22:52:02.824935Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T22:52:05.466780Z","title":null,"venue":null,"work_id":"7a5e7b0b-12c8-4ffb-a8c7-675429936842","year":null},"citing_paper":{"arxiv_id":"2508.06291","last_updated":"2025-08-08T13:11:54Z","snapshot_observed_at":"2026-08-06T19:27:56.147468Z","submitted_at":"2025-08-08T13:11:54Z","title":"Real-Time 3D Vision-Language Embedding Mapping","version":1},"reference_index":46,"source":"pdf_text","source_observed_at":"2026-08-05T22:52:02.829086Z"},"links":{"citing_paper":"/paper/2508.06291"},"observation_digest":"sha256:3b58b39188c37cf282625e52c498107a9f5864d98d3b59e492c4fd86c366b582","observation_id":"69e05da3-8985-4af2-9192-8013a0712e7c","resolution":{"observed_at":"2026-08-05T22:52:05.470757Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T22:52:05.453111Z","title":null,"venue":null,"work_id":"409db07b-9cdb-4af2-91d0-6a12c3c436f1","year":null},"citing_paper":{"arxiv_id":"2508.06291","last_updated":"2025-08-08T13:11:54Z","snapshot_observed_at":"2026-08-06T19:27:56.147468Z","submitted_at":"2025-08-08T13:11:54Z","title":"Real-Time 3D Vision-Language Embedding Mapping","version":1},"reference_index":47,"source":"pdf_text","source_observed_at":"2026-08-05T22:52:02.838261Z"},"links":{"citing_paper":"/paper/2508.06291"},"observation_digest":"sha256:48353db161832f26f54d633abd792d15d673a12a13bfb49e07a80d87a0823a57","observation_id":"1d8cedcb-ffc3-4763-af3e-46405e5f95e5","resolution":{"observed_at":"2026-08-05T22:52:05.457222Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T22:52:05.439907Z","title":"Theisel, T","venue":null,"work_id":"cf5ef3d2-4303-49d2-afc6-f524e4d57cd0","year":null},"citing_paper":{"arxiv_id":"2508.06291","last_updated":"2025-08-08T13:11:54Z","snapshot_observed_at":"2026-08-06T19:27:56.147468Z","submitted_at":"2025-08-08T13:11:54Z","title":"Real-Time 3D Vision-Language Embedding Mapping","version":1},"reference_index":48,"source":"pdf_text","source_observed_at":"2026-08-05T22:52:02.846309Z"},"links":{"citing_paper":"/paper/2508.06291"},"observation_digest":"sha256:0d617899b2aad6f36f54e9fbfeb220e953345dc8a2cd41bd7ebbab62f1f4497d","observation_id":"089c3e6c-cff5-456c-a0aa-9f7422f674f9","resolution":{"observed_at":"2026-08-05T22:52:05.443865Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1807.03748","last_updated":"2019-01-22T18:47:12Z","snapshot_observed_at":"2026-07-06T06:49:24.960992Z","submitted_at":"2018-07-10T16:52:11Z","title":"Representation Learning with Contrastive Predictive Coding","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1807.03748","snapshot_observed_at":"2026-08-05T22:52:02.854536Z","title":"van den Oord, Y","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2508.06291","last_updated":"2025-08-08T13:11:54Z","snapshot_observed_at":"2026-08-06T19:27:56.147468Z","submitted_at":"2025-08-08T13:11:54Z","title":"Real-Time 3D Vision-Language Embedding Mapping","version":1},"reference_index":49,"source":"pdf_text","source_observed_at":"2026-08-05T22:52:02.854536Z"},"links":{"cited_paper":"/paper/1807.03748","citing_paper":"/paper/2508.06291"},"observation_digest":"sha256:c032f68f29fc3707c2cd7bf752b58182696324ab49a9a8e133473252fac159da","observation_id":"c73eb095-6926-43ef-9c3b-5d6bdb56bdd4","resolution":{"observed_at":"2026-08-05T22:52:02.854536Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T22:52:02.859225Z","title":"Vincent, H","venue":null,"work_id":null,"year":2008},"citing_paper":{"arxiv_id":"2508.06291","last_updated":"2025-08-08T13:11:54Z","snapshot_observed_at":"2026-08-06T19:27:56.147468Z","submitted_at":"2025-08-08T13:11:54Z","title":"Real-Time 3D Vision-Language Embedding Mapping","version":1},"reference_index":50,"source":"pdf_text","source_observed_at":"2026-08-05T22:52:02.859225Z"},"links":{"citing_paper":"/paper/2508.06291"},"observation_digest":"sha256:c314459033d93985c32a0a85c7a79dc8b3e25771239def640482bae2bbd7b3a2","observation_id":"cfd044a6-1d2b-47dd-af23-479ea2914f43","resolution":{"observed_at":"2026-08-05T22:52:02.859225Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"4938.35258","doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T22:52:03.829219Z","title":"Wang and P","venue":null,"work_id":"7daa8d11-f206-4df5-bd22-95507e7d64cb","year":2020},"citing_paper":{"arxiv_id":"2508.06291","last_updated":"2025-08-08T13:11:54Z","snapshot_observed_at":"2026-08-06T19:27:56.147468Z","submitted_at":"2025-08-08T13:11:54Z","title":"Real-Time 3D Vision-Language Embedding Mapping","version":1},"reference_index":51,"source":"pdf_text","source_observed_at":"2026-08-05T22:52:02.863669Z"},"links":{"citing_paper":"/paper/2508.06291"},"observation_digest":"sha256:21379613517488d524daba8340926f6d1e61ab46e0e1cec3d5377e2f05bce626","observation_id":"04794417-ee7b-443e-97a8-b8bf905d9fd9","resolution":{"observed_at":"2026-08-05T22:52:03.836049Z","resolver_source":"raw_fallback","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":"10.1111/cgf.12990","metadata_source":"doi_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T22:52:02.994558Z","title":null,"venue":null,"work_id":"ad2c4069-25a4-480f-8292-ac77c376ab6d","year":2017},"citing_paper":{"arxiv_id":"2508.06291","last_updated":"2025-08-08T13:11:54Z","snapshot_observed_at":"2026-08-06T19:27:56.147468Z","submitted_at":"2025-08-08T13:11:54Z","title":"Real-Time 3D Vision-Language Embedding Mapping","version":1},"reference_index":52,"source":"pdf_text","source_observed_at":"2026-08-05T22:52:02.867669Z"},"links":{"citing_paper":"/paper/2508.06291"},"observation_digest":"sha256:bc4d4eca7eb24ffa7914bd76c187872c03a3e4eb8ac8aba7bd57f6dc01c0e145","observation_id":"725fa13d-fc1f-4c08-b8e1-a19f6906c630","resolution":{"observed_at":"2026-08-05T22:52:02.999019Z","resolver_source":"doi","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T22:52:02.872232Z","title":null,"venue":null,"work_id":null,"year":2010},"citing_paper":{"arxiv_id":"2508.06291","last_updated":"2025-08-08T13:11:54Z","snapshot_observed_at":"2026-08-06T19:27:56.147468Z","submitted_at":"2025-08-08T13:11:54Z","title":"Real-Time 3D Vision-Language Embedding Mapping","version":1},"reference_index":53,"source":"pdf_text","source_observed_at":"2026-08-05T22:52:02.872232Z"},"links":{"citing_paper":"/paper/2508.06291"},"observation_digest":"sha256:ef606c23c1690700e73c8a19f65688545bad9437ab4fd1c88b904a8cf76b9416","observation_id":"388a49ad-e48c-4275-8a31-0173f1254cb7","resolution":{"observed_at":"2026-08-05T22:52:02.872232Z","resolver_source":null,"status":"malformed_identifier"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T22:52:02.876029Z","title":"Xiang, H","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2508.06291","last_updated":"2025-08-08T13:11:54Z","snapshot_observed_at":"2026-08-06T19:27:56.147468Z","submitted_at":"2025-08-08T13:11:54Z","title":"Real-Time 3D Vision-Language Embedding Mapping","version":1},"reference_index":54,"source":"pdf_text","source_observed_at":"2026-08-05T22:52:02.876029Z"},"links":{"citing_paper":"/paper/2508.06291"},"observation_digest":"sha256:ceeafff9984e466ee10de44297ed1c2dd235794dc2e00943defb1cdaffe5d93c","observation_id":"e959404a-e7e9-45ca-b399-94bf6c77245e","resolution":{"observed_at":"2026-08-05T22:52:02.876029Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T22:52:02.880031Z","title":null,"venue":null,"work_id":null,"year":2010},"citing_paper":{"arxiv_id":"2508.06291","last_updated":"2025-08-08T13:11:54Z","snapshot_observed_at":"2026-08-06T19:27:56.147468Z","submitted_at":"2025-08-08T13:11:54Z","title":"Real-Time 3D Vision-Language Embedding Mapping","version":1},"reference_index":55,"source":"pdf_text","source_observed_at":"2026-08-05T22:52:02.880031Z"},"links":{"citing_paper":"/paper/2508.06291"},"observation_digest":"sha256:429b849c4e9184f305672e0bc5c9e85ef16805ed27c84941f46a4a513a1e198b","observation_id":"5c2b46b4-2c80-4ae8-b844-19603d8a2c68","resolution":{"observed_at":"2026-08-05T22:52:02.880031Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T22:52:05.425935Z","title":null,"venue":null,"work_id":"b84f8732-b967-4ca4-b37b-35406bbd589c","year":null},"citing_paper":{"arxiv_id":"2508.06291","last_updated":"2025-08-08T13:11:54Z","snapshot_observed_at":"2026-08-06T19:27:56.147468Z","submitted_at":"2025-08-08T13:11:54Z","title":"Real-Time 3D Vision-Language Embedding Mapping","version":1},"reference_index":56,"source":"pdf_text","source_observed_at":"2026-08-05T22:52:02.884285Z"},"links":{"citing_paper":"/paper/2508.06291"},"observation_digest":"sha256:146a6cccb05eb403ac34076da0df059287b8f18a8e3ec0821bd15e1ab82b344d","observation_id":"d5278393-5150-4e34-85d8-35ae5387c200","resolution":{"observed_at":"2026-08-05T22:52:05.430468Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2306.13549","last_updated":"2024-11-29T15:51:23Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2023-06-23T15:21:52Z","title":"A Survey on Multimodal Large Language Models","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2306.13549","snapshot_observed_at":"2026-08-05T22:52:02.892489Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2508.06291","last_updated":"2025-08-08T13:11:54Z","snapshot_observed_at":"2026-08-06T19:27:56.147468Z","submitted_at":"2025-08-08T13:11:54Z","title":"Real-Time 3D Vision-Language Embedding Mapping","version":1},"reference_index":57,"source":"pdf_text","source_observed_at":"2026-08-05T22:52:02.892489Z"},"links":{"cited_paper":"/paper/2306.13549","citing_paper":"/paper/2508.06291"},"observation_digest":"sha256:a05b095d43e8029c9d6b9b582c776dff4cbc276c5f63c2005750f012db3ad6b1","observation_id":"da9e81ec-a28b-4294-8223-8b7cfdf67831","resolution":{"observed_at":"2026-08-05T22:52:02.892489Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T22:52:02.900666Z","title":"Yu and C","venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2508.06291","last_updated":"2025-08-08T13:11:54Z","snapshot_observed_at":"2026-08-06T19:27:56.147468Z","submitted_at":"2025-08-08T13:11:54Z","title":"Real-Time 3D Vision-Language Embedding Mapping","version":1},"reference_index":58,"source":"pdf_text","source_observed_at":"2026-08-05T22:52:02.900666Z"},"links":{"citing_paper":"/paper/2508.06291"},"observation_digest":"sha256:876d9b1cb9ec48cb0ce6f05ce24950a23ef9e4c0fb867116d970bb30031f5d83","observation_id":"67e4dc92-e37f-46f6-a16f-ecc40b64df90","resolution":{"observed_at":"2026-08-05T22:52:02.900666Z","resolver_source":null,"status":"malformed_identifier"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T22:52:02.904581Z","title":"Zafar, D","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2508.06291","last_updated":"2025-08-08T13:11:54Z","snapshot_observed_at":"2026-08-06T19:27:56.147468Z","submitted_at":"2025-08-08T13:11:54Z","title":"Real-Time 3D Vision-Language Embedding Mapping","version":1},"reference_index":59,"source":"pdf_text","source_observed_at":"2026-08-05T22:52:02.904581Z"},"links":{"citing_paper":"/paper/2508.06291"},"observation_digest":"sha256:34c4870710874be3accd5756023512c105e710d455e09ec4ffa971ef4d4fa3b6","observation_id":"00de35ec-6b3b-4943-91eb-c8364ac7eb3a","resolution":{"observed_at":"2026-08-05T22:52:02.904581Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T22:52:02.908443Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2508.06291","last_updated":"2025-08-08T13:11:54Z","snapshot_observed_at":"2026-08-06T19:27:56.147468Z","submitted_at":"2025-08-08T13:11:54Z","title":"Real-Time 3D Vision-Language Embedding Mapping","version":1},"reference_index":60,"source":"pdf_text","source_observed_at":"2026-08-05T22:52:02.908443Z"},"links":{"citing_paper":"/paper/2508.06291"},"observation_digest":"sha256:725631e73a3a611b9947f1232cd6cb096890b6c93d6b8fa61a04a738acd8394f","observation_id":"50e767c0-8b87-477c-9575-adde5d8dd6bf","resolution":{"observed_at":"2026-08-05T22:52:02.908443Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T22:52:02.912049Z","title":"Hidden Dims","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2508.06291","last_updated":"2025-08-08T13:11:54Z","snapshot_observed_at":"2026-08-06T19:27:56.147468Z","submitted_at":"2025-08-08T13:11:54Z","title":"Real-Time 3D Vision-Language Embedding Mapping","version":1},"reference_index":61,"source":"pdf_text","source_observed_at":"2026-08-05T22:52:02.912049Z"},"links":{"citing_paper":"/paper/2508.06291"},"observation_digest":"sha256:df4fa0d3b3ecab1b25a50d53e3f4f59c7d6ce720feeb10ea57e4e78d2c64c8ae","observation_id":"750eb1c9-9de0-4015-88fa-c52513d2ab1e","resolution":{"observed_at":"2026-08-05T22:52:02.912049Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":"10.1007/978-3-031-72698-9","metadata_source":"openalex","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T11:07:33.414567Z","title":null,"venue":"Lecture notes in computer science","work_id":"892ffbf2-8420-47c2-aeb9-532c2337541d","year":null},"citing_paper":{"arxiv_id":"2508.06291","last_updated":"2025-08-08T13:11:54Z","snapshot_observed_at":"2026-08-06T19:27:56.147468Z","submitted_at":"2025-08-08T13:11:54Z","title":"Real-Time 3D Vision-Language Embedding Mapping","version":1},"reference_index":64,"source":"pdf_text","source_observed_at":"2026-08-05T22:52:02.888493Z"},"links":{"citing_paper":"/paper/2508.06291"},"observation_digest":"sha256:1863293ddebd34428e92e9f91d7849c2de04c889939331f10029fb552ed997c1","observation_id":"ee7fe5d2-b988-4f07-8439-7d071d9f3008","resolution":{"observed_at":"2026-08-05T22:52:02.974957Z","resolver_source":"doi","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T22:52:02.808077Z","title":null,"venue":null,"work_id":null,"year":2016},"citing_paper":{"arxiv_id":"2508.06291","last_updated":"2025-08-08T13:11:54Z","snapshot_observed_at":"2026-08-06T19:27:56.147468Z","submitted_at":"2025-08-08T13:11:54Z","title":"Real-Time 3D Vision-Language Embedding Mapping","version":1},"reference_index":377,"source":"pdf_text","source_observed_at":"2026-08-05T22:52:02.808077Z"},"links":{"citing_paper":"/paper/2508.06291"},"observation_digest":"sha256:68ab4fafdfc69193766a32511b1966bdacd53758672dab8cfd4b902b53b0d83c","observation_id":"78585923-991a-4b91-bf9b-01e056f2e9b0","resolution":{"observed_at":"2026-08-05T22:52:02.808077Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2003.12503","last_updated":"2020-03-27T16:11:57Z","snapshot_observed_at":"2026-08-06T07:19:21.081889Z","submitted_at":"2020-03-27T16:11:57Z","title":"Measurement of cumulants of conserved charge multiplicity distributions in Au+Au collisions from the STAR experiment","version":1},"cited_work":{"arxiv_id":"2003.12503","doi":null,"metadata_source":"pith","pith_arxiv_id":"2003.12503","snapshot_observed_at":"2026-08-05T22:52:03.933849Z","title":"Measurement of cumulants of conserved charge multiplicity distributions in Au+Au collisions from the STAR experiment","venue":"nucl-ex","work_id":"42b6fa98-2596-47d8-8052-206121675c82","year":2020},"citing_paper":{"arxiv_id":"2508.06291","last_updated":"2025-08-08T13:11:54Z","snapshot_observed_at":"2026-08-06T19:27:56.147468Z","submitted_at":"2025-08-08T13:11:54Z","title":"Real-Time 3D Vision-Language Embedding Mapping","version":1},"reference_index":2003,"source":"pdf_text","source_observed_at":"2026-08-05T22:52:02.850304Z"},"links":{"cited_paper":"/paper/2003.12503","citing_paper":"/paper/2508.06291"},"observation_digest":"sha256:56ae22e279d73062610ebc2e7ddca57be09edecd9c96165a6ebc3fc2d2d91148","observation_id":"77524a24-9964-40d4-bef0-6abb4287a82f","resolution":{"observed_at":"2026-08-05T22:52:03.938528Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T22:52:02.833940Z","title":null,"venue":null,"work_id":null,"year":2014},"citing_paper":{"arxiv_id":"2508.06291","last_updated":"2025-08-08T13:11:54Z","snapshot_observed_at":"2026-08-06T19:27:56.147468Z","submitted_at":"2025-08-08T13:11:54Z","title":"Real-Time 3D Vision-Language Embedding Mapping","version":1},"reference_index":2014,"source":"pdf_text","source_observed_at":"2026-08-05T22:52:02.833940Z"},"links":{"citing_paper":"/paper/2508.06291"},"observation_digest":"sha256:51c8c76c193e393be33ea4b029521fbd6f7260f6baf4a95941b7f4c984b9509e","observation_id":"a1f7c46e-1fcc-4e29-b72d-6b6966efa832","resolution":{"observed_at":"2026-08-05T22:52:02.833940Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"2015.24402","doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T22:52:04.004964Z","title":null,"venue":null,"work_id":"d77e1276-9b4c-4f4b-b07b-a96eb9663a87","year":2015},"citing_paper":{"arxiv_id":"2508.06291","last_updated":"2025-08-08T13:11:54Z","snapshot_observed_at":"2026-08-06T19:27:56.147468Z","submitted_at":"2025-08-08T13:11:54Z","title":"Real-Time 3D Vision-Language Embedding Mapping","version":1},"reference_index":2015,"source":"pdf_text","source_observed_at":"2026-08-05T22:52:02.842254Z"},"links":{"citing_paper":"/paper/2508.06291"},"observation_digest":"sha256:6219757d7a0cebff71946cab6b06fde7b27e13a7598210649ee150d2e2ded5ba","observation_id":"c1373ecd-8f88-4738-a44c-b1772f6c1256","resolution":{"observed_at":"2026-08-05T22:52:04.011778Z","resolver_source":"raw_fallback","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"2018.28802","doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T22:52:05.296321Z","title":null,"venue":null,"work_id":"265ac78a-84a5-4184-8cc6-d31a1da9caa6","year":2018},"citing_paper":{"arxiv_id":"2508.06291","last_updated":"2025-08-08T13:11:54Z","snapshot_observed_at":"2026-08-06T19:27:56.147468Z","submitted_at":"2025-08-08T13:11:54Z","title":"Real-Time 3D Vision-Language Embedding Mapping","version":1},"reference_index":2020,"source":"pdf_text","source_observed_at":"2026-08-05T22:51:59.728978Z"},"links":{"citing_paper":"/paper/2508.06291"},"observation_digest":"sha256:4ebef1a6df8c9190f4ced7f5959be40894c7015858e96b53492c13db75ad84db","observation_id":"a582a220-5401-4d9d-8675-5aa8db575e37","resolution":{"observed_at":"2026-08-05T22:52:05.302901Z","resolver_source":"raw_fallback","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2306.13549","last_updated":"2024-11-29T15:51:23Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2023-06-23T15:21:52Z","title":"A Survey on Multimodal Large Language Models","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2306.13549","snapshot_observed_at":"2026-08-05T22:52:02.896766Z","title":"doi: 10.48550/arXiv.2306.13549","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2508.06291","last_updated":"2025-08-08T13:11:54Z","snapshot_observed_at":"2026-08-06T19:27:56.147468Z","submitted_at":"2025-08-08T13:11:54Z","title":"Real-Time 3D Vision-Language Embedding Mapping","version":1},"reference_index":2023,"source":"pdf_text","source_observed_at":"2026-08-05T22:52:02.896766Z"},"links":{"cited_paper":"/paper/2306.13549","citing_paper":"/paper/2508.06291"},"observation_digest":"sha256:b68a3be052673779c931a7480d1863810f070f2f248e31ccb72bfb90f4bfd54c","observation_id":"afebf6c3-5526-4e2d-acd1-2a3442ad7e9f","resolution":{"observed_at":"2026-08-05T22:52:02.896766Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T22:52:05.562185Z","title":null,"venue":null,"work_id":"53edd71a-c0c3-4333-899d-c6f80dbb63f4","year":null},"citing_paper":{"arxiv_id":"2508.06291","last_updated":"2025-08-08T13:11:54Z","snapshot_observed_at":"2026-08-06T19:27:56.147468Z","submitted_at":"2025-08-08T13:11:54Z","title":"Real-Time 3D Vision-Language Embedding Mapping","version":1},"reference_index":2024,"source":"pdf_text","source_observed_at":"2026-08-05T22:51:59.052059Z"},"links":{"citing_paper":"/paper/2508.06291"},"observation_digest":"sha256:b58e88f801abd5f1fbcdebd6c553bb8e44e27084e86893c08c12c54974fb98d5","observation_id":"ac1bb145-e34e-48bb-a165-3a48cb2d25f3","resolution":{"observed_at":"2026-08-05T22:52:05.565826Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2401.14404","last_updated":"2024-01-25T18:59:57Z","snapshot_observed_at":"2026-08-06T14:37:40.501908Z","submitted_at":"2024-01-25T18:59:57Z","title":"Deconstructing Denoising Diffusion Models for Self-Supervised Learning","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2401.14404","snapshot_observed_at":"2026-08-05T22:51:59.142839Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2508.06291","last_updated":"2025-08-08T13:11:54Z","snapshot_observed_at":"2026-08-06T19:27:56.147468Z","submitted_at":"2025-08-08T13:11:54Z","title":"Real-Time 3D Vision-Language Embedding Mapping","version":1},"reference_index":2025,"source":"pdf_text","source_observed_at":"2026-08-05T22:51:59.142839Z"},"links":{"cited_paper":"/paper/2401.14404","citing_paper":"/paper/2508.06291"},"observation_digest":"sha256:1470d5dbaa70a1772dce1c23cc3161faff9951813bb62ddf355c8b499096c30b","observation_id":"1a260cd4-33ea-47ce-8f77-50b4789b6c0a","resolution":{"observed_at":"2026-08-05T22:51:59.142839Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"paper":{"arxiv_id":"2508.06291","last_updated":"2025-08-08T13:11:54Z","latest_version":1,"primary_category":"cs.RO","snapshot_observed_at":"2026-08-06T19:27:56.147468Z","submitted_at":"2025-08-08T13:11:54Z","title":"Real-Time 3D Vision-Language Embedding Mapping"},"reference_resolution":{"displayed":70,"state_counts":{"malformed_identifier":5,"metadata_mismatch":6,"parse_uncertain":0,"unresolved":42,"verified_exact":13,"verified_fuzzy":4},"total_outbound_references":70},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"thesis":"As of 7 August 2026, this Paper Citation Record lists 70 of 70 outbound references and 0 inbound Pith citation observations for arXiv:2508.06291."}