{"as_of":"2026-08-20T07:33:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:364c83afea344cb6f6a409d4592c6ac5350ca5300742fcda79d72a76e05b6d16","coverage":[{"denominator":67,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":67,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-08T20:48:50.959250Z","state":"measured"},{"denominator":70,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":70,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-20T06:33:59.587034+00:00","state":"measured"},{"denominator":3,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":3,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-11T13:08:48.562277Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"pith","source_observed_at":"2026-08-06T14:22:13.516252Z","state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2502.04981","last_updated":"2025-08-02T11:08:33Z","snapshot_observed_at":"2026-08-18T20:26:42.380307Z","submitted_at":"2025-02-07T14:58:59Z","title":"AutoOcc: Automatic Open-Ended Semantic Occupancy Annotation via Vision-Language Guided Gaussian Splatting","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2502.04981","snapshot_observed_at":"2026-08-11T13:08:48.562277Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2412.13509","last_updated":"2025-03-25T17:56:01Z","snapshot_observed_at":"2026-08-18T15:28:27.006022Z","submitted_at":"2024-12-18T05:16:11Z","title":"Visualizing the Invisible: A Generative AR System for Intuitive Multi-Modal Sensor Data Presentation","version":2},"reference_index":68,"source":"pdf_text","source_observed_at":"2026-08-11T13:08:48.562277Z"},"links":{"cited_paper":"/paper/2502.04981","citing_paper":"/paper/2412.13509"},"observation_digest":"sha256:99916149a4d06c7df2e53a1bdcf0dfbfaaeb4fe38d83f4563308d6dbbb437bc7","observation_id":"2ca0976b-17a7-442a-86d2-73ceb3db7491","resolution":{"observed_at":"2026-08-11T13:08:48.562277Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2502.04981","last_updated":"2025-08-02T11:08:33Z","snapshot_observed_at":"2026-08-18T20:26:42.380307Z","submitted_at":"2025-02-07T14:58:59Z","title":"AutoOcc: Automatic Open-Ended Semantic Occupancy Annotation via Vision-Language Guided Gaussian Splatting","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2502.04981","snapshot_observed_at":"2026-08-06T22:57:42.119019Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2506.20134","last_updated":"2025-06-25T05:05:09Z","snapshot_observed_at":"2026-08-17T14:41:09.622801Z","submitted_at":"2025-06-25T05:05:09Z","title":"From 2D to 3D Cognition: A Brief Survey of General World Models","version":1},"reference_index":196,"source":"pdf_text","source_observed_at":"2026-08-06T22:57:42.119019Z"},"links":{"cited_paper":"/paper/2502.04981","citing_paper":"/paper/2506.20134"},"observation_digest":"sha256:6ba42812d4171e24aca2bc590a9075d4b72bd1884235d856874a81a41df44d21","observation_id":"bc6fadf5-44f1-4144-8b88-cebd7e6d8922","resolution":{"observed_at":"2026-08-06T22:57:42.119019Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2502.04981","last_updated":"2025-08-02T11:08:33Z","snapshot_observed_at":"2026-08-18T20:26:42.380307Z","submitted_at":"2025-02-07T14:58:59Z","title":"AutoOcc: Automatic Open-Ended Semantic Occupancy Annotation via Vision-Language Guided Gaussian Splatting","version":3},"cited_work":{"arxiv_id":"2502.04981","doi":null,"metadata_source":"pith","pith_arxiv_id":"2502.04981","snapshot_observed_at":"2026-08-06T14:22:13.516252Z","title":"AutoOcc: Automatic Open-Ended Semantic Occupancy Annotation via Vision-Language Guided Gaussian Splatting","venue":"cs.CV","work_id":"d90208e3-8b46-45c0-8ade-c3f7dab8513d","year":2025},"citing_paper":{"arxiv_id":"2507.19451","last_updated":"2025-08-02T16:10:54Z","snapshot_observed_at":"2026-08-13T10:26:20.537525Z","submitted_at":"2025-07-25T17:33:23Z","title":"GS-Occ3D: Scaling Vision-only Occupancy Reconstruction with Gaussian Splatting","version":3},"reference_index":109,"source":"pdf_text","source_observed_at":"2026-08-06T14:22:13.492041Z"},"links":{"cited_paper":"/paper/2502.04981","citing_paper":"/paper/2507.19451"},"observation_digest":"sha256:f431dab5dfe9b02e4c6bb2d5e479f61aa0c126287bfb95682c956a3c3bd6a691","observation_id":"8b676b73-18d7-4026-b4b1-490e6a04f247","resolution":{"observed_at":"2026-08-06T14:22:13.520963Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}}],"links":{"evidence":"/evidence","html":"/paper/2502.04981/citation-record","integrity":"/paper/2502.04981/integrity","json":"/paper/2502.04981/citation-record.json","paper":"/paper/2502.04981"},"outbound":[{"citation":{"cited_paper":{"arxiv_id":"2005.00928","last_updated":"2020-05-31T16:59:40Z","snapshot_observed_at":"2026-08-14T07:01:16.499526Z","submitted_at":"2020-05-02T21:45:27Z","title":"Quantifying Attention Flow in Transformers","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2005.00928","snapshot_observed_at":"2026-08-08T20:48:50.724239Z","title":"Quantifying atten- tion flow in transformers","venue":null,"work_id":null,"year":2005},"citing_paper":{"arxiv_id":"2502.04981","last_updated":"2025-08-02T11:08:33Z","snapshot_observed_at":"2026-08-18T20:26:42.380307Z","submitted_at":"2025-02-07T14:58:59Z","title":"AutoOcc: Automatic Open-Ended Semantic Occupancy Annotation via Vision-Language Guided Gaussian Splatting","version":3},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-08T20:48:50.724239Z"},"links":{"cited_paper":"/paper/2005.00928","citing_paper":"/paper/2502.04981"},"observation_digest":"sha256:07710255b4b313c2e36b9286aad92e22561864adcbd3280b9878d0485dd1a266","observation_id":"0ebbbca7-d98b-4828-a18f-a5f9d9f62c76","resolution":{"observed_at":"2026-08-08T20:48:50.724239Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T20:48:51.649887Z","title":"Se- mantickitti: A dataset for semantic scene understanding of lidar sequences","venue":null,"work_id":"fe852cbe-9705-4184-9e40-3de1b57c14c8","year":2019},"citing_paper":{"arxiv_id":"2502.04981","last_updated":"2025-08-02T11:08:33Z","snapshot_observed_at":"2026-08-18T20:26:42.380307Z","submitted_at":"2025-02-07T14:58:59Z","title":"AutoOcc: Automatic Open-Ended Semantic Occupancy Annotation via Vision-Language Guided Gaussian Splatting","version":3},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-08T20:48:50.728621Z"},"links":{"citing_paper":"/paper/2502.04981"},"observation_digest":"sha256:750e95ec06dfc8e37bae2f13a01808a21ee09a68bb27faa7949b4bebf26f3543","observation_id":"363d3ee0-9aa6-42ad-8360-0881d58418f1","resolution":{"observed_at":"2026-08-08T20:48:51.653912Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2407.17310","last_updated":"2024-07-25T07:47:11Z","snapshot_observed_at":"2026-08-16T13:31:24.577469Z","submitted_at":"2024-07-24T14:22:55Z","title":"LangOcc: Self-Supervised Open Vocabulary Occupancy Estimation via Volume Rendering","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2407.17310","snapshot_observed_at":"2026-08-08T20:48:50.732356Z","title":"Lan- gocc: Self-supervised open vocabulary occupancy estima- tion via volume rendering.arXiv preprint arXiv:2407.17310,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2502.04981","last_updated":"2025-08-02T11:08:33Z","snapshot_observed_at":"2026-08-18T20:26:42.380307Z","submitted_at":"2025-02-07T14:58:59Z","title":"AutoOcc: Automatic Open-Ended Semantic Occupancy Annotation via Vision-Language Guided Gaussian Splatting","version":3},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-08T20:48:50.732356Z"},"links":{"cited_paper":"/paper/2407.17310","citing_paper":"/paper/2502.04981"},"observation_digest":"sha256:e76b06bcba56d984dd427326a6a5c2ed4d0b8102b6b8db2c8858e61734bdd73c","observation_id":"efa2c7d9-e2f8-4109-813f-4b3735ed7c8e","resolution":{"observed_at":"2026-08-08T20:48:50.732356Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2402.12792","last_updated":"2024-02-20T08:04:12Z","snapshot_observed_at":"2026-08-16T14:17:02.997248Z","submitted_at":"2024-02-20T08:04:12Z","title":"OccFlowNet: Towards Self-supervised Occupancy Estimation via Differentiable Rendering and Occupancy Flow","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.12792","snapshot_observed_at":"2026-08-08T20:48:50.736268Z","title":"Oc- cflownet: Towards self-supervised occupancy estimation via differentiable rendering and occupancy flow","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2502.04981","last_updated":"2025-08-02T11:08:33Z","snapshot_observed_at":"2026-08-18T20:26:42.380307Z","submitted_at":"2025-02-07T14:58:59Z","title":"AutoOcc: Automatic Open-Ended Semantic Occupancy Annotation via Vision-Language Guided Gaussian Splatting","version":3},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-08T20:48:50.736268Z"},"links":{"cited_paper":"/paper/2402.12792","citing_paper":"/paper/2502.04981"},"observation_digest":"sha256:811554bd96f5533f59828293cfa477c505a9174b13e35d7e0c7eca5c424797ae","observation_id":"68974260-58e8-4cb0-8d3e-08ae547d8ee2","resolution":{"observed_at":"2026-08-08T20:48:50.736268Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T20:48:51.638491Z","title":"Monoscene: Monoc- ular 3d semantic scene completion","venue":null,"work_id":"ef12cc98-1b12-45e4-8b39-eccf1ec8627c","year":2022},"citing_paper":{"arxiv_id":"2502.04981","last_updated":"2025-08-02T11:08:33Z","snapshot_observed_at":"2026-08-18T20:26:42.380307Z","submitted_at":"2025-02-07T14:58:59Z","title":"AutoOcc: Automatic Open-Ended Semantic Occupancy Annotation via Vision-Language Guided Gaussian Splatting","version":3},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-08T20:48:50.740298Z"},"links":{"citing_paper":"/paper/2502.04981"},"observation_digest":"sha256:c65128a3306d0a8662acf9d6b325b0d90bf4df384e57baef9bd028e6cc12f418","observation_id":"cd8daab9-1551-4f61-be30-df683c63b81a","resolution":{"observed_at":"2026-08-08T20:48:51.642454Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T20:48:51.627536Z","title":"Pointbev: A sparse approach for bev predictions","venue":null,"work_id":"295007c4-02f1-4084-80ef-001264e0585d","year":2024},"citing_paper":{"arxiv_id":"2502.04981","last_updated":"2025-08-02T11:08:33Z","snapshot_observed_at":"2026-08-18T20:26:42.380307Z","submitted_at":"2025-02-07T14:58:59Z","title":"AutoOcc: Automatic Open-Ended Semantic Occupancy Annotation via Vision-Language Guided Gaussian Splatting","version":3},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-08T20:48:50.743884Z"},"links":{"citing_paper":"/paper/2502.04981"},"observation_digest":"sha256:1af39ec062f3108cd15f368447be5590abb334b4f8802b4be910bfb7c4d956b6","observation_id":"60261df1-4f3a-47bd-b997-e04426a84774","resolution":{"observed_at":"2026-08-08T20:48:51.631447Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T20:48:51.616191Z","title":"Seal: Self- supervised embodied active learning using exploration and 3d consistency","venue":null,"work_id":"7890e4c0-bf53-4b5d-97c8-dac4b2f2bd0d","year":2021},"citing_paper":{"arxiv_id":"2502.04981","last_updated":"2025-08-02T11:08:33Z","snapshot_observed_at":"2026-08-18T20:26:42.380307Z","submitted_at":"2025-02-07T14:58:59Z","title":"AutoOcc: Automatic Open-Ended Semantic Occupancy Annotation via Vision-Language Guided Gaussian Splatting","version":3},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-08T20:48:50.747537Z"},"links":{"citing_paper":"/paper/2502.04981"},"observation_digest":"sha256:3754794bee298973b2f4cf7550042671b19f8726427f3b16c3b26a42032f5218","observation_id":"16df6a2f-c8ca-4181-a24a-5fffdf89eb96","resolution":{"observed_at":"2026-08-08T20:48:51.620162Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T20:48:51.604734Z","title":"V oxelnext: Fully sparse voxelnet for 3d object detection and tracking","venue":null,"work_id":"a4ee0534-05c0-41ad-8651-51bde852d2ea","year":2023},"citing_paper":{"arxiv_id":"2502.04981","last_updated":"2025-08-02T11:08:33Z","snapshot_observed_at":"2026-08-18T20:26:42.380307Z","submitted_at":"2025-02-07T14:58:59Z","title":"AutoOcc: Automatic Open-Ended Semantic Occupancy Annotation via Vision-Language Guided Gaussian Splatting","version":3},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-08T20:48:50.751027Z"},"links":{"citing_paper":"/paper/2502.04981"},"observation_digest":"sha256:3b62c0f3c119f5d575709bd60a20ac06ca38715b5780d1982e093ed27e14e7bc","observation_id":"14530e2d-c362-44e0-bfdf-97d7cf080ce8","resolution":{"observed_at":"2026-08-08T20:48:51.608711Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T20:48:50.754330Z","title":"Internvl: Scaling up vision foundation mod- els and aligning for generic visual-linguistic tasks","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2502.04981","last_updated":"2025-08-02T11:08:33Z","snapshot_observed_at":"2026-08-18T20:26:42.380307Z","submitted_at":"2025-02-07T14:58:59Z","title":"AutoOcc: Automatic Open-Ended Semantic Occupancy Annotation via Vision-Language Guided Gaussian Splatting","version":3},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-08T20:48:50.754330Z"},"links":{"citing_paper":"/paper/2502.04981"},"observation_digest":"sha256:8b1388fabeb4807eff0a952c55dadf392b6cc35986c1fced7c3349b1cbebd801","observation_id":"3637c3b9-30f1-48fa-acbd-12fd8de8253d","resolution":{"observed_at":"2026-08-08T20:48:50.754330Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T20:48:51.586067Z","title":"Yolo-world: Real-time open- vocabulary object detection","venue":null,"work_id":"bfdf4b6c-850b-4cd4-978a-5a20bd40fb89","year":2024},"citing_paper":{"arxiv_id":"2502.04981","last_updated":"2025-08-02T11:08:33Z","snapshot_observed_at":"2026-08-18T20:26:42.380307Z","submitted_at":"2025-02-07T14:58:59Z","title":"AutoOcc: Automatic Open-Ended Semantic Occupancy Annotation via Vision-Language Guided Gaussian Splatting","version":3},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-08T20:48:50.757604Z"},"links":{"citing_paper":"/paper/2502.04981"},"observation_digest":"sha256:dec391e9c55c0e7b5a1ac90684f802a9080af62d90b72d48b92242852e386316","observation_id":"6552a8e2-d3f8-4f9a-8b31-a8d0aaf11794","resolution":{"observed_at":"2026-08-08T20:48:51.590249Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T20:48:51.574872Z","title":"A point set generation network for 3d object reconstruction from a single image","venue":null,"work_id":"8e7c979b-dece-4dfe-800d-8229d75cb67a","year":2017},"citing_paper":{"arxiv_id":"2502.04981","last_updated":"2025-08-02T11:08:33Z","snapshot_observed_at":"2026-08-18T20:26:42.380307Z","submitted_at":"2025-02-07T14:58:59Z","title":"AutoOcc: Automatic Open-Ended Semantic Occupancy Annotation via Vision-Language Guided Gaussian Splatting","version":3},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-08T20:48:50.761097Z"},"links":{"citing_paper":"/paper/2502.04981"},"observation_digest":"sha256:20e7494a853300f2688882fdbd409380be3275ed8a309e7dce4709447ca1736b","observation_id":"872cfebd-c95d-4d9e-a59e-c732805b836d","resolution":{"observed_at":"2026-08-08T20:48:51.578964Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2406.03175","last_updated":"2024-11-23T13:09:50Z","snapshot_observed_at":"2026-08-16T13:45:55.919916Z","submitted_at":"2024-06-05T12:07:39Z","title":"Dynamic 3D Gaussian Fields for Urban Areas","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2406.03175","snapshot_observed_at":"2026-08-08T20:48:50.764570Z","title":"Dy- namic 3d gaussian fields for urban areas","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2502.04981","last_updated":"2025-08-02T11:08:33Z","snapshot_observed_at":"2026-08-18T20:26:42.380307Z","submitted_at":"2025-02-07T14:58:59Z","title":"AutoOcc: Automatic Open-Ended Semantic Occupancy Annotation via Vision-Language Guided Gaussian Splatting","version":3},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-08T20:48:50.764570Z"},"links":{"cited_paper":"/paper/2406.03175","citing_paper":"/paper/2502.04981"},"observation_digest":"sha256:14dce8b413fd67bf7ea450df6e64f4a25b24d3999f795177d7b65990a5611155","observation_id":"f73c8c7f-5033-4aaa-b22e-3aed6b224096","resolution":{"observed_at":"2026-08-08T20:48:50.764570Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T20:48:51.563837Z","title":"Gaussianocc: Fully self-supervised and effi- cient 3d occupancy estimation with gaussian splatting.arXiv e-prints, 2024","venue":null,"work_id":"90199226-c0c5-4d1a-bd8f-16fe10e4a5cc","year":2024},"citing_paper":{"arxiv_id":"2502.04981","last_updated":"2025-08-02T11:08:33Z","snapshot_observed_at":"2026-08-18T20:26:42.380307Z","submitted_at":"2025-02-07T14:58:59Z","title":"AutoOcc: Automatic Open-Ended Semantic Occupancy Annotation via Vision-Language Guided Gaussian Splatting","version":3},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-08T20:48:50.768198Z"},"links":{"citing_paper":"/paper/2502.04981"},"observation_digest":"sha256:ac0f863d73d628ae5827f70880d2249983ce39e8b6112df756137868c6ad55b8","observation_id":"9ab928a1-467c-406c-978a-5b5276f0be4a","resolution":{"observed_at":"2026-08-08T20:48:51.567838Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T20:48:51.552046Z","title":"A comprehensive framework for 3d occupancy estimation in autonomous driving","venue":null,"work_id":"0016c623-d39a-4d3f-863d-a5daa56a6544","year":2024},"citing_paper":{"arxiv_id":"2502.04981","last_updated":"2025-08-02T11:08:33Z","snapshot_observed_at":"2026-08-18T20:26:42.380307Z","submitted_at":"2025-02-07T14:58:59Z","title":"AutoOcc: Automatic Open-Ended Semantic Occupancy Annotation via Vision-Language Guided Gaussian Splatting","version":3},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-08T20:48:50.771811Z"},"links":{"citing_paper":"/paper/2502.04981"},"observation_digest":"sha256:dd0c2a23ff7f96ffd7ecc6cfa7ba16e80bccd013d814eb7e4cdcaa12348b8d85","observation_id":"40e8d076-887c-4f97-8d78-3e7046b5183d","resolution":{"observed_at":"2026-08-08T20:48:51.556079Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T20:48:51.541167Z","title":"Simple-bev: What really matters for multi-sensor bev perception? In ICRA, pages 2759–2765","venue":null,"work_id":"a165c637-89bb-48de-8c62-2335f254f3aa","year":2023},"citing_paper":{"arxiv_id":"2502.04981","last_updated":"2025-08-02T11:08:33Z","snapshot_observed_at":"2026-08-18T20:26:42.380307Z","submitted_at":"2025-02-07T14:58:59Z","title":"AutoOcc: Automatic Open-Ended Semantic Occupancy Annotation via Vision-Language Guided Gaussian Splatting","version":3},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-08T20:48:50.775485Z"},"links":{"citing_paper":"/paper/2502.04981"},"observation_digest":"sha256:ba6cef15a90bd0ba3780bf114dba62156111991564483cf14fcbbd61e3016d40","observation_id":"acf5e5ef-619d-4cc2-aa58-443372483634","resolution":{"observed_at":"2026-08-08T20:48:51.545131Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T20:48:51.530297Z","title":"Tri-perspective view for vision-based 3d se- mantic occupancy prediction","venue":null,"work_id":"4caaf969-bcaf-4683-baad-6d8dc71da366","year":null},"citing_paper":{"arxiv_id":"2502.04981","last_updated":"2025-08-02T11:08:33Z","snapshot_observed_at":"2026-08-18T20:26:42.380307Z","submitted_at":"2025-02-07T14:58:59Z","title":"AutoOcc: Automatic Open-Ended Semantic Occupancy Annotation via Vision-Language Guided Gaussian Splatting","version":3},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-08T20:48:50.778707Z"},"links":{"citing_paper":"/paper/2502.04981"},"observation_digest":"sha256:e4baa1a1e6ef10e47f24d8eb11640e9913c89bd70beb41ab8035442c4f78ee62","observation_id":"46f8949a-4595-4543-9f9a-8d821dc87fe1","resolution":{"observed_at":"2026-08-08T20:48:51.534440Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T20:48:51.518780Z","title":"Selfocc: Self-supervised vision-based 3d oc- cupancy prediction","venue":null,"work_id":"6192342f-8e83-4422-8dff-a4eff73a426f","year":2024},"citing_paper":{"arxiv_id":"2502.04981","last_updated":"2025-08-02T11:08:33Z","snapshot_observed_at":"2026-08-18T20:26:42.380307Z","submitted_at":"2025-02-07T14:58:59Z","title":"AutoOcc: Automatic Open-Ended Semantic Occupancy Annotation via Vision-Language Guided Gaussian Splatting","version":3},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-08T20:48:50.782163Z"},"links":{"citing_paper":"/paper/2502.04981"},"observation_digest":"sha256:1404d70688e713a740c50debbb7a21d0131daeb0894b5682e3f90018ecb422b4","observation_id":"4c6115fd-d6f2-45e3-ab19-90048d524e93","resolution":{"observed_at":"2026-08-08T20:48:51.523259Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T20:48:51.508239Z","title":"Segment anything in high qual- ity","venue":null,"work_id":"bf43dddf-5ece-425d-82eb-72c4a70597ae","year":2024},"citing_paper":{"arxiv_id":"2502.04981","last_updated":"2025-08-02T11:08:33Z","snapshot_observed_at":"2026-08-18T20:26:42.380307Z","submitted_at":"2025-02-07T14:58:59Z","title":"AutoOcc: Automatic Open-Ended Semantic Occupancy Annotation via Vision-Language Guided Gaussian Splatting","version":3},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-08T20:48:50.785583Z"},"links":{"citing_paper":"/paper/2502.04981"},"observation_digest":"sha256:4436076ccaa15a6e2b8d9963ee0947a57d2ec6d4a8269c0164aaded9d3192af0","observation_id":"b9ba0290-b416-4906-8483-1e6fde5e1a8c","resolution":{"observed_at":"2026-08-08T20:48:51.511664Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T20:48:50.789080Z","title":"3d gaussian splatting for real-time radiance field rendering","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2502.04981","last_updated":"2025-08-02T11:08:33Z","snapshot_observed_at":"2026-08-18T20:26:42.380307Z","submitted_at":"2025-02-07T14:58:59Z","title":"AutoOcc: Automatic Open-Ended Semantic Occupancy Annotation via Vision-Language Guided Gaussian Splatting","version":3},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-08T20:48:50.789080Z"},"links":{"citing_paper":"/paper/2502.04981"},"observation_digest":"sha256:be13c00960070dbb2ea1766947b4e59c1ba4fc35f0c1a3ac650a41ebe43af829","observation_id":"4a42e28e-6000-4ca7-b56d-32c629911407","resolution":{"observed_at":"2026-08-08T20:48:50.789080Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T20:48:51.491812Z","title":"Segment any- thing","venue":null,"work_id":"0a2e6922-48a9-4976-ab0d-2206cd966528","year":2023},"citing_paper":{"arxiv_id":"2502.04981","last_updated":"2025-08-02T11:08:33Z","snapshot_observed_at":"2026-08-18T20:26:42.380307Z","submitted_at":"2025-02-07T14:58:59Z","title":"AutoOcc: Automatic Open-Ended Semantic Occupancy Annotation via Vision-Language Guided Gaussian Splatting","version":3},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-08T20:48:50.793035Z"},"links":{"citing_paper":"/paper/2502.04981"},"observation_digest":"sha256:cd27ca9f425b6e183e1a5b748e8c84ee63aa040ee26d64c05fbf115402dbdbf5","observation_id":"012631ac-3a0e-47b6-8839-4675370b0f1f","resolution":{"observed_at":"2026-08-08T20:48:51.495204Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2209.15639","last_updated":"2023-02-23T19:14:52Z","snapshot_observed_at":"2026-08-16T16:27:46.006186Z","submitted_at":"2022-09-30T17:59:52Z","title":"F-VLM: Open-Vocabulary Object Detection upon Frozen Vision and Language Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2209.15639","snapshot_observed_at":"2026-08-08T20:48:50.796941Z","title":"F-vlm: Open-vocabulary object detec- tion upon frozen vision and language models","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2502.04981","last_updated":"2025-08-02T11:08:33Z","snapshot_observed_at":"2026-08-18T20:26:42.380307Z","submitted_at":"2025-02-07T14:58:59Z","title":"AutoOcc: Automatic Open-Ended Semantic Occupancy Annotation via Vision-Language Guided Gaussian Splatting","version":3},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-08T20:48:50.796941Z"},"links":{"cited_paper":"/paper/2209.15639","citing_paper":"/paper/2502.04981"},"observation_digest":"sha256:1897572127507cbeea8b582b711a94e0f1d4062e6d5c8dbbce9a648c87e5ed9a","observation_id":"1b2a88f8-3331-4f65-b549-d1edd7db2922","resolution":{"observed_at":"2026-08-08T20:48:50.796941Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T20:48:50.800743Z","title":"Grounded language-image pre-training","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2502.04981","last_updated":"2025-08-02T11:08:33Z","snapshot_observed_at":"2026-08-18T20:26:42.380307Z","submitted_at":"2025-02-07T14:58:59Z","title":"AutoOcc: Automatic Open-Ended Semantic Occupancy Annotation via Vision-Language Guided Gaussian Splatting","version":3},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-08T20:48:50.800743Z"},"links":{"citing_paper":"/paper/2502.04981"},"observation_digest":"sha256:7256ad4e5450d22e37a2dfea43d9121361a0ccd8df1a6814815ddaf5f9254b4c","observation_id":"5dc41fca-e1cf-45af-ad03-555a9c7dc988","resolution":{"observed_at":"2026-08-08T20:48:50.800743Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T20:48:51.475770Z","title":"Unifying voxel-based representation with transformer for 3d object detection","venue":null,"work_id":"4d080a5c-824e-4891-ad74-32804d08e102","year":null},"citing_paper":{"arxiv_id":"2502.04981","last_updated":"2025-08-02T11:08:33Z","snapshot_observed_at":"2026-08-18T20:26:42.380307Z","submitted_at":"2025-02-07T14:58:59Z","title":"AutoOcc: Automatic Open-Ended Semantic Occupancy Annotation via Vision-Language Guided Gaussian Splatting","version":3},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-08T20:48:50.803969Z"},"links":{"citing_paper":"/paper/2502.04981"},"observation_digest":"sha256:0ba5a13636320d8cbd8afde64400f50b61d94515a843e9b9f1f5d82afbcf863d","observation_id":"bc88f851-aba7-4281-9748-30fe11807407","resolution":{"observed_at":"2026-08-08T20:48:51.479149Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T20:48:51.465790Z","title":"V oxel field fusion for 3d object detection","venue":null,"work_id":"72fea361-8acd-4adb-bdf8-d7b9b42ec0ea","year":2022},"citing_paper":{"arxiv_id":"2502.04981","last_updated":"2025-08-02T11:08:33Z","snapshot_observed_at":"2026-08-18T20:26:42.380307Z","submitted_at":"2025-02-07T14:58:59Z","title":"AutoOcc: Automatic Open-Ended Semantic Occupancy Annotation via Vision-Language Guided Gaussian Splatting","version":3},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-08T20:48:50.807392Z"},"links":{"citing_paper":"/paper/2502.04981"},"observation_digest":"sha256:19cc3f1d71f9894d048fc54f0c2de284cbaba046b752d007747a2ec73bf6495d","observation_id":"fc8f6f93-c473-4c5c-a950-704cd9979111","resolution":{"observed_at":"2026-08-08T20:48:51.469214Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T20:48:51.455049Z","title":"Fast-bev: A fast and strong bird’s-eye view perception baseline","venue":null,"work_id":"868b5ca3-bf56-463b-b3ff-4fb490560450","year":2024},"citing_paper":{"arxiv_id":"2502.04981","last_updated":"2025-08-02T11:08:33Z","snapshot_observed_at":"2026-08-18T20:26:42.380307Z","submitted_at":"2025-02-07T14:58:59Z","title":"AutoOcc: Automatic Open-Ended Semantic Occupancy Annotation via Vision-Language Guided Gaussian Splatting","version":3},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-08-08T20:48:50.810846Z"},"links":{"citing_paper":"/paper/2502.04981"},"observation_digest":"sha256:889a3ce0f94b2068a25966534fde1781b2cbeb3af3f91c9962be5a5a5b876a96","observation_id":"04850b70-b9d8-42cc-89e8-1d1e3af29e1d","resolution":{"observed_at":"2026-08-08T20:48:51.459203Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T20:48:50.814308Z","title":"Bevformer: Learning bird’s-eye-view representation from multi-camera images via spatiotemporal transformers","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2502.04981","last_updated":"2025-08-02T11:08:33Z","snapshot_observed_at":"2026-08-18T20:26:42.380307Z","submitted_at":"2025-02-07T14:58:59Z","title":"AutoOcc: Automatic Open-Ended Semantic Occupancy Annotation via Vision-Language Guided Gaussian Splatting","version":3},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-08-08T20:48:50.814308Z"},"links":{"citing_paper":"/paper/2502.04981"},"observation_digest":"sha256:f74e40f4cddf9d6e85887bb99257aa76458ec00b0c5505783e0d3233cee52755","observation_id":"05d2b313-ff90-44af-9f53-f1582ebaae43","resolution":{"observed_at":"2026-08-08T20:48:50.814308Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2307.01492","last_updated":"2023-07-04T05:55:54Z","snapshot_observed_at":"2026-08-18T08:37:31.401379Z","submitted_at":"2023-07-04T05:55:54Z","title":"FB-OCC: 3D Occupancy Prediction based on Forward-Backward View Transformation","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2307.01492","snapshot_observed_at":"2026-08-08T20:48:50.818612Z","title":"Fb-occ: 3d occupancy prediction based on forward-backward view transformation","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2502.04981","last_updated":"2025-08-02T11:08:33Z","snapshot_observed_at":"2026-08-18T20:26:42.380307Z","submitted_at":"2025-02-07T14:58:59Z","title":"AutoOcc: Automatic Open-Ended Semantic Occupancy Annotation via Vision-Language Guided Gaussian Splatting","version":3},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-08-08T20:48:50.818612Z"},"links":{"cited_paper":"/paper/2307.01492","citing_paper":"/paper/2502.04981"},"observation_digest":"sha256:b48e114c15e768f130a3c474d853f086daa6cf1b395cf707123bd21220e44198","observation_id":"fd31fb11-a82a-4bd5-94ef-5be6f521448f","resolution":{"observed_at":"2026-08-08T20:48:50.818612Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T20:48:51.437808Z","title":"Generative region-language pretraining for open-ended object detection","venue":null,"work_id":"ba01743c-fa4b-4e3e-abf8-f8638029907e","year":2024},"citing_paper":{"arxiv_id":"2502.04981","last_updated":"2025-08-02T11:08:33Z","snapshot_observed_at":"2026-08-18T20:26:42.380307Z","submitted_at":"2025-02-07T14:58:59Z","title":"AutoOcc: Automatic Open-Ended Semantic Occupancy Annotation via Vision-Language Guided Gaussian Splatting","version":3},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-08-08T20:48:50.822650Z"},"links":{"citing_paper":"/paper/2502.04981"},"observation_digest":"sha256:1e4436d2e30491e62b71408dd96fa9d6e6697c9c6b9d8c0664c972583cf90efe","observation_id":"34fd9619-5f52-4d34-b1e0-e4b005e7328c","resolution":{"observed_at":"2026-08-08T20:48:51.441889Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2410.05963","last_updated":"2024-10-08T12:15:08Z","snapshot_observed_at":"2026-08-19T19:37:43.858265Z","submitted_at":"2024-10-08T12:15:08Z","title":"Training-Free Open-Ended Object Detection and Segmentation via Attention as Prompts","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2410.05963","snapshot_observed_at":"2026-08-08T20:48:50.826026Z","title":"Training-free open-ended object detection and segmentation via attention as prompts","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2502.04981","last_updated":"2025-08-02T11:08:33Z","snapshot_observed_at":"2026-08-18T20:26:42.380307Z","submitted_at":"2025-02-07T14:58:59Z","title":"AutoOcc: Automatic Open-Ended Semantic Occupancy Annotation via Vision-Language Guided Gaussian Splatting","version":3},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-08-08T20:48:50.826026Z"},"links":{"cited_paper":"/paper/2410.05963","citing_paper":"/paper/2502.04981"},"observation_digest":"sha256:3a7d60f6932fee5456c5be723f9562548f2c4281678ae014673a99392572498f","observation_id":"75b5572e-7504-4007-8d20-c4e7427762e8","resolution":{"observed_at":"2026-08-08T20:48:50.826026Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2303.05499","last_updated":"2024-07-19T06:00:41Z","snapshot_observed_at":"2026-08-19T16:02:58.628969Z","submitted_at":"2023-03-09T18:52:16Z","title":"Grounding DINO: Marrying DINO with Grounded Pre-Training for Open-Set Object Detection","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2303.05499","snapshot_observed_at":"2026-08-08T20:48:50.830008Z","title":"Grounding dino: Marrying dino with grounded pre-training for open-set object detection","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2502.04981","last_updated":"2025-08-02T11:08:33Z","snapshot_observed_at":"2026-08-18T20:26:42.380307Z","submitted_at":"2025-02-07T14:58:59Z","title":"AutoOcc: Automatic Open-Ended Semantic Occupancy Annotation via Vision-Language Guided Gaussian Splatting","version":3},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-08-08T20:48:50.830008Z"},"links":{"cited_paper":"/paper/2303.05499","citing_paper":"/paper/2502.04981"},"observation_digest":"sha256:d2b0ea5bdfe36280d68e3862b1502fadfb086fb8036268d8b1ab464830882537","observation_id":"2bd136ec-4d68-4223-9aa5-9db4c29eedf0","resolution":{"observed_at":"2026-08-08T20:48:50.830008Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T20:48:50.833808Z","title":"Grounding dino: Marrying dino with grounded pre-training for open-set object detection","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2502.04981","last_updated":"2025-08-02T11:08:33Z","snapshot_observed_at":"2026-08-18T20:26:42.380307Z","submitted_at":"2025-02-07T14:58:59Z","title":"AutoOcc: Automatic Open-Ended Semantic Occupancy Annotation via Vision-Language Guided Gaussian Splatting","version":3},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-08-08T20:48:50.833808Z"},"links":{"citing_paper":"/paper/2502.04981"},"observation_digest":"sha256:b8f7c021f30cbd8e9d88fa08e8d0fb5554f4988ec4589a6080c618474553c08d","observation_id":"8681004c-267e-4a4e-ae6c-1e82db332a09","resolution":{"observed_at":"2026-08-08T20:48:50.833808Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T20:48:51.421360Z","title":"Ovir-3d: Open-vocabulary 3d in- stance retrieval without training on 3d data","venue":null,"work_id":"ec5c3651-50b8-4f52-a899-8f5f1b36692e","year":2023},"citing_paper":{"arxiv_id":"2502.04981","last_updated":"2025-08-02T11:08:33Z","snapshot_observed_at":"2026-08-18T20:26:42.380307Z","submitted_at":"2025-02-07T14:58:59Z","title":"AutoOcc: Automatic Open-Ended Semantic Occupancy Annotation via Vision-Language Guided Gaussian Splatting","version":3},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-08-08T20:48:50.837198Z"},"links":{"citing_paper":"/paper/2502.04981"},"observation_digest":"sha256:00451394fc4d11dab72f8044ceb7f4b3d4856eeffbd5fabc4f9ac3449af52805","observation_id":"4502e5e2-7b68-44b1-8e07-59c302058249","resolution":{"observed_at":"2026-08-08T20:48:51.424860Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T20:48:51.411412Z","title":"Bev- guided multi-modality fusion for driving perception","venue":null,"work_id":"002f6649-5390-41c9-b195-8e805cb6fea2","year":2023},"citing_paper":{"arxiv_id":"2502.04981","last_updated":"2025-08-02T11:08:33Z","snapshot_observed_at":"2026-08-18T20:26:42.380307Z","submitted_at":"2025-02-07T14:58:59Z","title":"AutoOcc: Automatic Open-Ended Semantic Occupancy Annotation via Vision-Language Guided Gaussian Splatting","version":3},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-08-08T20:48:50.840496Z"},"links":{"citing_paper":"/paper/2502.04981"},"observation_digest":"sha256:da7e4481c3559c09cd96af8b88ed2ed47299e16c1fa48e4f660ccb7683725769","observation_id":"ae7a9c20-55ea-46fe-9c95-e063204e7bcb","resolution":{"observed_at":"2026-08-08T20:48:51.414913Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2306.09117","last_updated":"2023-06-15T13:23:57Z","snapshot_observed_at":"2026-08-20T01:33:51.369236Z","submitted_at":"2023-06-15T13:23:57Z","title":"UniOcc: Unifying Vision-Centric 3D Occupancy Prediction with Geometric and Semantic Rendering","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2306.09117","snapshot_observed_at":"2026-08-08T20:48:50.843877Z","title":"Uniocc: Unifying vision-centric 3d oc- cupancy prediction with geometric and semantic rendering","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2502.04981","last_updated":"2025-08-02T11:08:33Z","snapshot_observed_at":"2026-08-18T20:26:42.380307Z","submitted_at":"2025-02-07T14:58:59Z","title":"AutoOcc: Automatic Open-Ended Semantic Occupancy Annotation via Vision-Language Guided Gaussian Splatting","version":3},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-08-08T20:48:50.843877Z"},"links":{"cited_paper":"/paper/2306.09117","citing_paper":"/paper/2502.04981"},"observation_digest":"sha256:26319981542105a70649e5bdbd618aa157c1cf405839e76b1359c8b329a49c75","observation_id":"45bc247b-1b9e-4bee-9ffe-1a9405655f1e","resolution":{"observed_at":"2026-08-08T20:48:50.843877Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T20:48:51.400940Z","title":"Renderocc: Vision-centric 3d occupancy predic- tion with 2d rendering supervision","venue":null,"work_id":"9f0b70c0-b97f-442d-9105-850aa6577ae8","year":2024},"citing_paper":{"arxiv_id":"2502.04981","last_updated":"2025-08-02T11:08:33Z","snapshot_observed_at":"2026-08-18T20:26:42.380307Z","submitted_at":"2025-02-07T14:58:59Z","title":"AutoOcc: Automatic Open-Ended Semantic Occupancy Annotation via Vision-Language Guided Gaussian Splatting","version":3},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-08-08T20:48:50.848127Z"},"links":{"citing_paper":"/paper/2502.04981"},"observation_digest":"sha256:3a0695a5b37ad2fd12250cf2f3c5b2b2ed18a200c6fa48e5d5c8cfe7be721acf","observation_id":"27b5a7f9-c75a-4cad-afec-7b39faec5891","resolution":{"observed_at":"2026-08-08T20:48:51.404510Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T20:48:50.851433Z","title":"Unidepth: Universal monocular metric depth estimation","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2502.04981","last_updated":"2025-08-02T11:08:33Z","snapshot_observed_at":"2026-08-18T20:26:42.380307Z","submitted_at":"2025-02-07T14:58:59Z","title":"AutoOcc: Automatic Open-Ended Semantic Occupancy Annotation via Vision-Language Guided Gaussian Splatting","version":3},"reference_index":36,"source":"pdf_text","source_observed_at":"2026-08-08T20:48:50.851433Z"},"links":{"citing_paper":"/paper/2502.04981"},"observation_digest":"sha256:685cf161e3f0e13e6e2ca77038d97c0ebdb999a53615c9be0c9e9ae398c6abd0","observation_id":"ff91df43-bf24-4763-a594-af5217f14414","resolution":{"observed_at":"2026-08-08T20:48:50.851433Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T20:48:51.384792Z","title":"Langsplat: 3d language gaussian splatting","venue":null,"work_id":"e7d2ac30-5db2-4102-94df-2cf7ae557ea3","year":2024},"citing_paper":{"arxiv_id":"2502.04981","last_updated":"2025-08-02T11:08:33Z","snapshot_observed_at":"2026-08-18T20:26:42.380307Z","submitted_at":"2025-02-07T14:58:59Z","title":"AutoOcc: Automatic Open-Ended Semantic Occupancy Annotation via Vision-Language Guided Gaussian Splatting","version":3},"reference_index":37,"source":"pdf_text","source_observed_at":"2026-08-08T20:48:50.854689Z"},"links":{"citing_paper":"/paper/2502.04981"},"observation_digest":"sha256:17f996a160a8480b37896ff208a38db5dc9b436105316dc0050d3e02dfb32fd7","observation_id":"8cee80d3-2717-4712-b36e-a92e7e1d3eee","resolution":{"observed_at":"2026-08-08T20:48:51.388008Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T20:48:51.375223Z","title":"Occupancy anticipation for efficient exploration and navigation","venue":null,"work_id":"0751ac19-b18b-4faf-a230-aefaed56c51e","year":2020},"citing_paper":{"arxiv_id":"2502.04981","last_updated":"2025-08-02T11:08:33Z","snapshot_observed_at":"2026-08-18T20:26:42.380307Z","submitted_at":"2025-02-07T14:58:59Z","title":"AutoOcc: Automatic Open-Ended Semantic Occupancy Annotation via Vision-Language Guided Gaussian Splatting","version":3},"reference_index":38,"source":"pdf_text","source_observed_at":"2026-08-08T20:48:50.858127Z"},"links":{"citing_paper":"/paper/2502.04981"},"observation_digest":"sha256:0e1c7ec4eaa2cf691d5f65a029b6cbb444967842cd7311834b10eb9b275966a5","observation_id":"72edf2c1-44ab-41a3-902e-686eadb44922","resolution":{"observed_at":"2026-08-08T20:48:51.378496Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T20:48:51.365483Z","title":"An exploration of embodied visual exploration","venue":null,"work_id":"1880f95c-ab17-4002-8004-baccfd25d2f7","year":2021},"citing_paper":{"arxiv_id":"2502.04981","last_updated":"2025-08-02T11:08:33Z","snapshot_observed_at":"2026-08-18T20:26:42.380307Z","submitted_at":"2025-02-07T14:58:59Z","title":"AutoOcc: Automatic Open-Ended Semantic Occupancy Annotation via Vision-Language Guided Gaussian Splatting","version":3},"reference_index":39,"source":"pdf_text","source_observed_at":"2026-08-08T20:48:50.861560Z"},"links":{"citing_paper":"/paper/2502.04981"},"observation_digest":"sha256:b9184394c913358a74d50c4fe9635d8cf4a467b8b8a220aceddc65845b7d2c8a","observation_id":"44ee7f17-e675-4904-94c1-34c7d8f60ebe","resolution":{"observed_at":"2026-08-08T20:48:51.369210Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2408.00714","last_updated":"2024-10-28T16:37:57Z","snapshot_observed_at":"2026-07-06T18:55:41.459417Z","submitted_at":"2024-08-01T17:00:08Z","title":"SAM 2: Segment Anything in Images and Videos","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2408.00714","snapshot_observed_at":"2026-08-08T20:48:50.864869Z","title":"Sam 2: Segment anything in images and videos","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2502.04981","last_updated":"2025-08-02T11:08:33Z","snapshot_observed_at":"2026-08-18T20:26:42.380307Z","submitted_at":"2025-02-07T14:58:59Z","title":"AutoOcc: Automatic Open-Ended Semantic Occupancy Annotation via Vision-Language Guided Gaussian Splatting","version":3},"reference_index":40,"source":"pdf_text","source_observed_at":"2026-08-08T20:48:50.864869Z"},"links":{"cited_paper":"/paper/2408.00714","citing_paper":"/paper/2502.04981"},"observation_digest":"sha256:53df0746f7806efbdf90c63c0248d05a98d8039c8a860f58d5912d59d853b96a","observation_id":"cbec6a56-a437-4105-b584-7d80edc186ab","resolution":{"observed_at":"2026-08-08T20:48:50.864869Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2401.14159","last_updated":"2024-01-25T13:12:09Z","snapshot_observed_at":"2026-07-06T17:20:25.138890Z","submitted_at":"2024-01-25T13:12:09Z","title":"Grounded SAM: Assembling Open-World Models for Diverse Visual Tasks","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2401.14159","snapshot_observed_at":"2026-08-08T20:48:50.868716Z","title":"Grounded sam: Assembling open-world models for diverse visual tasks","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2502.04981","last_updated":"2025-08-02T11:08:33Z","snapshot_observed_at":"2026-08-18T20:26:42.380307Z","submitted_at":"2025-02-07T14:58:59Z","title":"AutoOcc: Automatic Open-Ended Semantic Occupancy Annotation via Vision-Language Guided Gaussian Splatting","version":3},"reference_index":41,"source":"pdf_text","source_observed_at":"2026-08-08T20:48:50.868716Z"},"links":{"cited_paper":"/paper/2401.14159","citing_paper":"/paper/2502.04981"},"observation_digest":"sha256:893a6630c9e0414cb768cc0dc48627652e1516b0f315f6a5538c4cad739d5983","observation_id":"b5618c75-ba58-47a0-9f65-9c8e90dfbbbb","resolution":{"observed_at":"2026-08-08T20:48:50.868716Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T20:48:51.355569Z","title":"Toward open set recogni- tion","venue":null,"work_id":"1ad12519-4777-42e3-af79-700a19181b18","year":2012},"citing_paper":{"arxiv_id":"2502.04981","last_updated":"2025-08-02T11:08:33Z","snapshot_observed_at":"2026-08-18T20:26:42.380307Z","submitted_at":"2025-02-07T14:58:59Z","title":"AutoOcc: Automatic Open-Ended Semantic Occupancy Annotation via Vision-Language Guided Gaussian Splatting","version":3},"reference_index":42,"source":"pdf_text","source_observed_at":"2026-08-08T20:48:50.872479Z"},"links":{"citing_paper":"/paper/2502.04981"},"observation_digest":"sha256:17021f50962fd956e886836b356eb62c55b0cdaf115f570aac2c73d32a0caa88","observation_id":"021fbf40-8309-444a-8c18-8dcb0345d550","resolution":{"observed_at":"2026-08-08T20:48:51.359318Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2407.04049","last_updated":"2024-07-04T16:46:22Z","snapshot_observed_at":"2026-08-16T13:36:59.580513Z","submitted_at":"2024-07-04T16:46:22Z","title":"Occupancy as Set of Points","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2407.04049","snapshot_observed_at":"2026-08-08T20:48:50.876193Z","title":"Occupancy as set of points","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2502.04981","last_updated":"2025-08-02T11:08:33Z","snapshot_observed_at":"2026-08-18T20:26:42.380307Z","submitted_at":"2025-02-07T14:58:59Z","title":"AutoOcc: Automatic Open-Ended Semantic Occupancy Annotation via Vision-Language Guided Gaussian Splatting","version":3},"reference_index":43,"source":"pdf_text","source_observed_at":"2026-08-08T20:48:50.876193Z"},"links":{"cited_paper":"/paper/2407.04049","citing_paper":"/paper/2502.04981"},"observation_digest":"sha256:865acfef1b081655212f2f4cb272a4daba9cbb1c25b7da9074a7599976653dbd","observation_id":"176c8bbb-3410-4717-82fa-1f41a2310081","resolution":{"observed_at":"2026-08-08T20:48:50.876193Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2305.16133","last_updated":"2023-06-14T17:30:54Z","snapshot_observed_at":"2026-08-16T15:29:41.460262Z","submitted_at":"2023-05-25T15:07:25Z","title":"OVO: Open-Vocabulary Occupancy","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2305.16133","snapshot_observed_at":"2026-08-08T20:48:50.879865Z","title":"Ovo: Open-vocabulary occupancy","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2502.04981","last_updated":"2025-08-02T11:08:33Z","snapshot_observed_at":"2026-08-18T20:26:42.380307Z","submitted_at":"2025-02-07T14:58:59Z","title":"AutoOcc: Automatic Open-Ended Semantic Occupancy Annotation via Vision-Language Guided Gaussian Splatting","version":3},"reference_index":44,"source":"pdf_text","source_observed_at":"2026-08-08T20:48:50.879865Z"},"links":{"cited_paper":"/paper/2305.16133","citing_paper":"/paper/2502.04981"},"observation_digest":"sha256:16e6ae209937433961ceda697a070321b616a4eb4e8e6cc84c8dee8d82d0fd8d","observation_id":"ef45b3f8-05bd-43bc-af56-551071fbdd1c","resolution":{"observed_at":"2026-08-08T20:48:50.879865Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2409.12753","last_updated":"2024-12-21T06:32:24Z","snapshot_observed_at":"2026-08-16T13:17:11.343602Z","submitted_at":"2024-09-19T13:16:04Z","title":"DrivingForward: Feed-forward 3D Gaussian Splatting for Driving Scene Reconstruction from Flexible Surround-view Input","version":2},"cited_work":{"arxiv_id":"2409.12753","doi":null,"metadata_source":"pith","pith_arxiv_id":"2409.12753","snapshot_observed_at":"2026-08-08T20:48:51.049675Z","title":"DrivingForward: Feed-forward 3D Gaussian Splatting for Driving Scene Reconstruction from Flexible Surround-view Input","venue":"cs.CV","work_id":"fa93a00d-0819-412d-b8e7-066e8217d280","year":2024},"citing_paper":{"arxiv_id":"2502.04981","last_updated":"2025-08-02T11:08:33Z","snapshot_observed_at":"2026-08-18T20:26:42.380307Z","submitted_at":"2025-02-07T14:58:59Z","title":"AutoOcc: Automatic Open-Ended Semantic Occupancy Annotation via Vision-Language Guided Gaussian Splatting","version":3},"reference_index":45,"source":"pdf_text","source_observed_at":"2026-08-08T20:48:50.883687Z"},"links":{"cited_paper":"/paper/2409.12753","citing_paper":"/paper/2502.04981"},"observation_digest":"sha256:b3429ba63043c4909ee8bbb73ebb7684d6621112c60a43accc6957ae7ac38eed","observation_id":"259f4773-d1ee-4e2d-8f65-06f5aa282026","resolution":{"observed_at":"2026-08-08T20:48:51.055857Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T20:48:51.345737Z","title":"Occ3d: A large-scale 3d occupancy prediction benchmark for autonomous driving","venue":null,"work_id":"6ffb1993-c857-44a3-8fb7-42f2b228cb3b","year":2024},"citing_paper":{"arxiv_id":"2502.04981","last_updated":"2025-08-02T11:08:33Z","snapshot_observed_at":"2026-08-18T20:26:42.380307Z","submitted_at":"2025-02-07T14:58:59Z","title":"AutoOcc: Automatic Open-Ended Semantic Occupancy Annotation via Vision-Language Guided Gaussian Splatting","version":3},"reference_index":46,"source":"pdf_text","source_observed_at":"2026-08-08T20:48:50.887368Z"},"links":{"citing_paper":"/paper/2502.04981"},"observation_digest":"sha256:53d372309cf62619a45ec28e7507a96bd816b68bffd0dfeffb6be53a6183c24e","observation_id":"18490f20-22f6-4b3f-b03e-ba9b7cbba544","resolution":{"observed_at":"2026-08-08T20:48:51.349308Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T20:48:51.336053Z","title":"Scene as occupancy","venue":null,"work_id":"8e39e601-5edf-415d-a9c4-dd9477dd2893","year":2023},"citing_paper":{"arxiv_id":"2502.04981","last_updated":"2025-08-02T11:08:33Z","snapshot_observed_at":"2026-08-18T20:26:42.380307Z","submitted_at":"2025-02-07T14:58:59Z","title":"AutoOcc: Automatic Open-Ended Semantic Occupancy Annotation via Vision-Language Guided Gaussian Splatting","version":3},"reference_index":47,"source":"pdf_text","source_observed_at":"2026-08-08T20:48:50.890508Z"},"links":{"citing_paper":"/paper/2502.04981"},"observation_digest":"sha256:a6c9704bcb53d4f45d70116507b34a3ce0e24528d3267ea85fdf1a73e07ceffd","observation_id":"3a69d98f-00f2-46d3-91ae-9459be769d44","resolution":{"observed_at":"2026-08-08T20:48:51.339378Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T20:48:51.326407Z","title":"Learning-based 3d occupancy prediction for autonomous navigation in occluded environments","venue":null,"work_id":"bd4517a0-265a-4f85-a380-8ab481d7544a","year":2021},"citing_paper":{"arxiv_id":"2502.04981","last_updated":"2025-08-02T11:08:33Z","snapshot_observed_at":"2026-08-18T20:26:42.380307Z","submitted_at":"2025-02-07T14:58:59Z","title":"AutoOcc: Automatic Open-Ended Semantic Occupancy Annotation via Vision-Language Guided Gaussian Splatting","version":3},"reference_index":48,"source":"pdf_text","source_observed_at":"2026-08-08T20:48:50.893897Z"},"links":{"citing_paper":"/paper/2502.04981"},"observation_digest":"sha256:ac84b2b29a3d4b6563986e96b63426e4a6a16e8619bfe7a608df7ec3afa5b288","observation_id":"b9da35ea-2525-4124-a9af-681fa4314a89","resolution":{"observed_at":"2026-08-08T20:48:51.329805Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T20:48:51.315857Z","title":"Openoccupancy: A large scale benchmark for sur- rounding semantic occupancy perception","venue":null,"work_id":"88e57fbd-04ec-4886-9898-0bbcc7ebddc4","year":2023},"citing_paper":{"arxiv_id":"2502.04981","last_updated":"2025-08-02T11:08:33Z","snapshot_observed_at":"2026-08-18T20:26:42.380307Z","submitted_at":"2025-02-07T14:58:59Z","title":"AutoOcc: Automatic Open-Ended Semantic Occupancy Annotation via Vision-Language Guided Gaussian Splatting","version":3},"reference_index":49,"source":"pdf_text","source_observed_at":"2026-08-08T20:48:50.897237Z"},"links":{"citing_paper":"/paper/2502.04981"},"observation_digest":"sha256:15345952be13bf095f4ddcb3c9088a9ebc8e853ca0ca23c08502d420813f7648","observation_id":"ff532603-98d8-4bcd-ac38-7846151eabac","resolution":{"observed_at":"2026-08-08T20:48:51.319785Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T20:48:51.304675Z","title":"Panoocc: Unified occupancy representation for camera-based 3d panoptic segmentation","venue":null,"work_id":"e70288bb-0824-494b-99cf-862d8e0fcc31","year":2024},"citing_paper":{"arxiv_id":"2502.04981","last_updated":"2025-08-02T11:08:33Z","snapshot_observed_at":"2026-08-18T20:26:42.380307Z","submitted_at":"2025-02-07T14:58:59Z","title":"AutoOcc: Automatic Open-Ended Semantic Occupancy Annotation via Vision-Language Guided Gaussian Splatting","version":3},"reference_index":50,"source":"pdf_text","source_observed_at":"2026-08-08T20:48:50.900463Z"},"links":{"citing_paper":"/paper/2502.04981"},"observation_digest":"sha256:d2bb17f74653360818ed4b9dd328dffb4a8aab84c4922f7f12da6f222cd7fa32","observation_id":"ccbc12f5-a866-41f0-b268-b46d0ab77314","resolution":{"observed_at":"2026-08-08T20:48:51.308704Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T20:48:51.293424Z","title":"Surroundocc: Multi-camera 3d occu- pancy prediction for autonomous driving","venue":null,"work_id":"c0e5c449-cab1-47de-a8d1-d62683247ad5","year":2023},"citing_paper":{"arxiv_id":"2502.04981","last_updated":"2025-08-02T11:08:33Z","snapshot_observed_at":"2026-08-18T20:26:42.380307Z","submitted_at":"2025-02-07T14:58:59Z","title":"AutoOcc: Automatic Open-Ended Semantic Occupancy Annotation via Vision-Language Guided Gaussian Splatting","version":3},"reference_index":51,"source":"pdf_text","source_observed_at":"2026-08-08T20:48:50.903983Z"},"links":{"citing_paper":"/paper/2502.04981"},"observation_digest":"sha256:43a3ae8f75e148900f021424bdc1a81e77a33a1efb41aac7c6e0163bddb70efe","observation_id":"149cf87e-5580-49f5-9b83-cb7a89376486","resolution":{"observed_at":"2026-08-08T20:48:51.297483Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T20:48:51.283362Z","title":"Towards open vocabulary learning: A survey","venue":null,"work_id":"d372173a-427a-4580-8e07-2db0462d99ea","year":2024},"citing_paper":{"arxiv_id":"2502.04981","last_updated":"2025-08-02T11:08:33Z","snapshot_observed_at":"2026-08-18T20:26:42.380307Z","submitted_at":"2025-02-07T14:58:59Z","title":"AutoOcc: Automatic Open-Ended Semantic Occupancy Annotation via Vision-Language Guided Gaussian Splatting","version":3},"reference_index":52,"source":"pdf_text","source_observed_at":"2026-08-08T20:48:50.907362Z"},"links":{"citing_paper":"/paper/2502.04981"},"observation_digest":"sha256:60163217c16e8b5a2b38b5174f5426bb5f7c7db2c2b5f3ce4d5cb9eafecb79c3","observation_id":"92254872-b683-421f-b406-1b8a3565eb74","resolution":{"observed_at":"2026-08-08T20:48:51.286790Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2105.09996","last_updated":"2021-09-30T22:43:19Z","snapshot_observed_at":"2026-08-16T18:23:16.914149Z","submitted_at":"2021-05-20T19:13:27Z","title":"VLM: Task-agnostic Video-Language Model Pre-training for Video Understanding","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2105.09996","snapshot_observed_at":"2026-08-08T20:48:50.910615Z","title":"Vlm: Task-agnostic video- language model pre-training for video understanding","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2502.04981","last_updated":"2025-08-02T11:08:33Z","snapshot_observed_at":"2026-08-18T20:26:42.380307Z","submitted_at":"2025-02-07T14:58:59Z","title":"AutoOcc: Automatic Open-Ended Semantic Occupancy Annotation via Vision-Language Guided Gaussian Splatting","version":3},"reference_index":53,"source":"pdf_text","source_observed_at":"2026-08-08T20:48:50.910615Z"},"links":{"cited_paper":"/paper/2105.09996","citing_paper":"/paper/2502.04981"},"observation_digest":"sha256:a5f7b51b50dcc93e184608ceda28ee142780e6839e22ca553a9a1b09a45f8cde","observation_id":"44be1a16-d6c4-49e7-8b77-9b3ced128894","resolution":{"observed_at":"2026-08-08T20:48:50.910615Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2311.17707","last_updated":"2025-02-04T11:40:44Z","snapshot_observed_at":"2026-08-19T02:19:59.998264Z","submitted_at":"2023-11-29T15:11:03Z","title":"SAMPro3D: Locating SAM Prompts in 3D for Zero-Shot Instance Segmentation","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2311.17707","snapshot_observed_at":"2026-08-08T20:48:50.914157Z","title":"Sampro3d: Locating sam prompts in 3d for zero-shot scene segmentation","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2502.04981","last_updated":"2025-08-02T11:08:33Z","snapshot_observed_at":"2026-08-18T20:26:42.380307Z","submitted_at":"2025-02-07T14:58:59Z","title":"AutoOcc: Automatic Open-Ended Semantic Occupancy Annotation via Vision-Language Guided Gaussian Splatting","version":3},"reference_index":54,"source":"pdf_text","source_observed_at":"2026-08-08T20:48:50.914157Z"},"links":{"cited_paper":"/paper/2311.17707","citing_paper":"/paper/2502.04981"},"observation_digest":"sha256:b92c3f238bbf3ed882b76cbddda3ebc6bf76d7dbb6d05ac959c1ca80180c2a85","observation_id":"7397b869-ce68-4b24-bc86-38f30f5262df","resolution":{"observed_at":"2026-08-08T20:48:50.914157Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T20:48:51.273245Z","title":"Depth anything: Unleashing the power of large-scale unlabeled data","venue":null,"work_id":"5902da52-89a0-41d5-b98d-a184cc94b31e","year":2024},"citing_paper":{"arxiv_id":"2502.04981","last_updated":"2025-08-02T11:08:33Z","snapshot_observed_at":"2026-08-18T20:26:42.380307Z","submitted_at":"2025-02-07T14:58:59Z","title":"AutoOcc: Automatic Open-Ended Semantic Occupancy Annotation via Vision-Language Guided Gaussian Splatting","version":3},"reference_index":55,"source":"pdf_text","source_observed_at":"2026-08-08T20:48:50.917690Z"},"links":{"citing_paper":"/paper/2502.04981"},"observation_digest":"sha256:05562a62a6bf70efb5f49fa64992117f5ddc803412bce9ce728c2f70226661d6","observation_id":"ae2d79e7-2e48-4304-b2b1-afb1b31321f9","resolution":{"observed_at":"2026-08-08T20:48:51.276919Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2311.12058","last_updated":"2023-11-18T15:28:09Z","snapshot_observed_at":"2026-08-16T14:42:10.713390Z","submitted_at":"2023-11-18T15:28:09Z","title":"FlashOcc: Fast and Memory-Efficient Occupancy Prediction via Channel-to-Height Plugin","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2311.12058","snapshot_observed_at":"2026-08-08T20:48:50.921031Z","title":"Flashocc: Fast and memory-efficient occupancy prediction via channel-to-height plugin","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2502.04981","last_updated":"2025-08-02T11:08:33Z","snapshot_observed_at":"2026-08-18T20:26:42.380307Z","submitted_at":"2025-02-07T14:58:59Z","title":"AutoOcc: Automatic Open-Ended Semantic Occupancy Annotation via Vision-Language Guided Gaussian Splatting","version":3},"reference_index":56,"source":"pdf_text","source_observed_at":"2026-08-08T20:48:50.921031Z"},"links":{"cited_paper":"/paper/2311.12058","citing_paper":"/paper/2502.04981"},"observation_digest":"sha256:945c08237e4a4331c311001b7e79284c4230112a556bdbd88fa63d08415f895c","observation_id":"75ef95cd-0b93-4059-8640-4df25798e329","resolution":{"observed_at":"2026-08-08T20:48:50.921031Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T20:48:51.263522Z","title":"Mip-splatting: Alias-free 3d gaussian splat- ting","venue":null,"work_id":"7e9f411e-3365-43d2-a521-291addd2798e","year":2024},"citing_paper":{"arxiv_id":"2502.04981","last_updated":"2025-08-02T11:08:33Z","snapshot_observed_at":"2026-08-18T20:26:42.380307Z","submitted_at":"2025-02-07T14:58:59Z","title":"AutoOcc: Automatic Open-Ended Semantic Occupancy Annotation via Vision-Language Guided Gaussian Splatting","version":3},"reference_index":57,"source":"pdf_text","source_observed_at":"2026-08-08T20:48:50.924687Z"},"links":{"citing_paper":"/paper/2502.04981"},"observation_digest":"sha256:a63170e1394ecfbad610915b3e739df134734cbaad3074097bb49b78cd426acc","observation_id":"1a294b78-3c4e-4ec4-bbca-8b9a85703393","resolution":{"observed_at":"2026-08-08T20:48:51.266876Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2306.14289","last_updated":"2023-07-01T07:26:22Z","snapshot_observed_at":"2026-08-20T05:25:54.653744Z","submitted_at":"2023-06-25T16:37:25Z","title":"Faster Segment Anything: Towards Lightweight SAM for Mobile Applications","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2306.14289","snapshot_observed_at":"2026-08-08T20:48:50.927878Z","title":"Faster segment anything: Towards lightweight sam for mo- bile applications","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2502.04981","last_updated":"2025-08-02T11:08:33Z","snapshot_observed_at":"2026-08-18T20:26:42.380307Z","submitted_at":"2025-02-07T14:58:59Z","title":"AutoOcc: Automatic Open-Ended Semantic Occupancy Annotation via Vision-Language Guided Gaussian Splatting","version":3},"reference_index":58,"source":"pdf_text","source_observed_at":"2026-08-08T20:48:50.927878Z"},"links":{"cited_paper":"/paper/2306.14289","citing_paper":"/paper/2502.04981"},"observation_digest":"sha256:b737b8b0f934dfda18051b40c03a07fef051075bc499a4b5d35d68b521a07fa5","observation_id":"c127ef22-2971-432b-95dd-1a653525869b","resolution":{"observed_at":"2026-08-08T20:48:50.927878Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T20:48:51.252776Z","title":"Occnerf: Self- supervised multi-camera occupancy prediction with neural radiance fields","venue":null,"work_id":"73bc0a48-cad4-41f4-8125-eec7bc692d54","year":2023},"citing_paper":{"arxiv_id":"2502.04981","last_updated":"2025-08-02T11:08:33Z","snapshot_observed_at":"2026-08-18T20:26:42.380307Z","submitted_at":"2025-02-07T14:58:59Z","title":"AutoOcc: Automatic Open-Ended Semantic Occupancy Annotation via Vision-Language Guided Gaussian Splatting","version":3},"reference_index":59,"source":"pdf_text","source_observed_at":"2026-08-08T20:48:50.931716Z"},"links":{"citing_paper":"/paper/2502.04981"},"observation_digest":"sha256:52b73b1639fc6cdc9b615543caee8d1557c27d3449d5744e6473580ddac75153","observation_id":"3e29bdbd-5488-480d-b1ab-e62e58b2e79c","resolution":{"observed_at":"2026-08-08T20:48:51.256755Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2306.02245","last_updated":"2024-01-29T12:14:04Z","snapshot_observed_at":"2026-08-16T15:26:50.289187Z","submitted_at":"2023-06-04T03:09:21Z","title":"SAM3D: Zero-Shot 3D Object Detection via Segment Anything Model","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2306.02245","snapshot_observed_at":"2026-08-08T20:48:50.934951Z","title":"Sam3d: Zero-shot 3d object detection via segment anything model","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2502.04981","last_updated":"2025-08-02T11:08:33Z","snapshot_observed_at":"2026-08-18T20:26:42.380307Z","submitted_at":"2025-02-07T14:58:59Z","title":"AutoOcc: Automatic Open-Ended Semantic Occupancy Annotation via Vision-Language Guided Gaussian Splatting","version":3},"reference_index":60,"source":"pdf_text","source_observed_at":"2026-08-08T20:48:50.934951Z"},"links":{"cited_paper":"/paper/2306.02245","citing_paper":"/paper/2502.04981"},"observation_digest":"sha256:a51100180b22ab55a0877c14ea157607fc59682b23d3ccf4197c5bca678883d8","observation_id":"d6082a33-428b-4efd-b9a6-c7662690ca45","resolution":{"observed_at":"2026-08-08T20:48:50.934951Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T20:48:51.241902Z","title":"A simple framework for open-vocabulary segmentation and detection","venue":null,"work_id":"f1717ab1-5546-4636-8b90-fc117d5e37be","year":2023},"citing_paper":{"arxiv_id":"2502.04981","last_updated":"2025-08-02T11:08:33Z","snapshot_observed_at":"2026-08-18T20:26:42.380307Z","submitted_at":"2025-02-07T14:58:59Z","title":"AutoOcc: Automatic Open-Ended Semantic Occupancy Annotation via Vision-Language Guided Gaussian Splatting","version":3},"reference_index":61,"source":"pdf_text","source_observed_at":"2026-08-08T20:48:50.938603Z"},"links":{"citing_paper":"/paper/2502.04981"},"observation_digest":"sha256:e0b677d19579181994a0e76e326be138e9c79a4aa69f76c6f1eb2eea644e6b60","observation_id":"7bed5d03-6f66-4a43-9b9b-bd51adf9e5ad","resolution":{"observed_at":"2026-08-08T20:48:51.245410Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T20:48:51.231635Z","title":"Occformer: Dual-path transformer for vision-based 3d semantic occu- pancy prediction","venue":null,"work_id":"de2407bc-b67c-48c0-aa8f-b97467b2e207","year":2023},"citing_paper":{"arxiv_id":"2502.04981","last_updated":"2025-08-02T11:08:33Z","snapshot_observed_at":"2026-08-18T20:26:42.380307Z","submitted_at":"2025-02-07T14:58:59Z","title":"AutoOcc: Automatic Open-Ended Semantic Occupancy Annotation via Vision-Language Guided Gaussian Splatting","version":3},"reference_index":62,"source":"pdf_text","source_observed_at":"2026-08-08T20:48:50.941849Z"},"links":{"citing_paper":"/paper/2502.04981"},"observation_digest":"sha256:4614e7ad11daf808f4f95521ee96c37f6930e79f8fd22ff172a0826a1ebf885e","observation_id":"df0793c7-b6f0-49d6-b683-54af6856508f","resolution":{"observed_at":"2026-08-08T20:48:51.235179Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T20:48:51.221445Z","title":"Lif-seg: Lidar and camera image fusion for 3d lidar semantic segmentation","venue":null,"work_id":"412e101b-45ff-4466-8c15-efa0a4df2a2e","year":2023},"citing_paper":{"arxiv_id":"2502.04981","last_updated":"2025-08-02T11:08:33Z","snapshot_observed_at":"2026-08-18T20:26:42.380307Z","submitted_at":"2025-02-07T14:58:59Z","title":"AutoOcc: Automatic Open-Ended Semantic Occupancy Annotation via Vision-Language Guided Gaussian Splatting","version":3},"reference_index":63,"source":"pdf_text","source_observed_at":"2026-08-08T20:48:50.945104Z"},"links":{"citing_paper":"/paper/2502.04981"},"observation_digest":"sha256:7f5c42e515fdd47b1213e3243dfa20552589e6ae8bd6bca14200f64b78c4a4a1","observation_id":"6a4da08e-c1d5-4653-9cac-a0d64cacc371","resolution":{"observed_at":"2026-08-08T20:48:51.225086Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T20:48:51.211105Z","title":"Fusion of 3d lidar and camera data for object detection in autonomous vehicle applications","venue":null,"work_id":"6608918c-a038-4e59-83f7-d53bfd690cd5","year":2020},"citing_paper":{"arxiv_id":"2502.04981","last_updated":"2025-08-02T11:08:33Z","snapshot_observed_at":"2026-08-18T20:26:42.380307Z","submitted_at":"2025-02-07T14:58:59Z","title":"AutoOcc: Automatic Open-Ended Semantic Occupancy Annotation via Vision-Language Guided Gaussian Splatting","version":3},"reference_index":64,"source":"pdf_text","source_observed_at":"2026-08-08T20:48:50.948381Z"},"links":{"citing_paper":"/paper/2502.04981"},"observation_digest":"sha256:cbd7dd66d218207e6f9a03f9ed4b21cb04633137b256a529adbdf52fb2003416","observation_id":"f76d3d72-780f-43a2-a577-a3353834c0cd","resolution":{"observed_at":"2026-08-08T20:48:51.214739Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2306.12156","last_updated":"2023-06-21T10:08:29Z","snapshot_observed_at":"2026-08-19T15:15:13.657700Z","submitted_at":"2023-06-21T10:08:29Z","title":"Fast Segment Anything","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2306.12156","snapshot_observed_at":"2026-08-08T20:48:50.952298Z","title":"Fast segment any- thing","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2502.04981","last_updated":"2025-08-02T11:08:33Z","snapshot_observed_at":"2026-08-18T20:26:42.380307Z","submitted_at":"2025-02-07T14:58:59Z","title":"AutoOcc: Automatic Open-Ended Semantic Occupancy Annotation via Vision-Language Guided Gaussian Splatting","version":3},"reference_index":65,"source":"pdf_text","source_observed_at":"2026-08-08T20:48:50.952298Z"},"links":{"cited_paper":"/paper/2306.12156","citing_paper":"/paper/2502.04981"},"observation_digest":"sha256:c6fc78809ee29b2ad3b1643fa01c79e60cff5f3ab86c57590316d84b10db0a8d","observation_id":"378c12ce-98db-4d27-8978-e10e961668c1","resolution":{"observed_at":"2026-08-08T20:48:50.952298Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T20:48:51.200786Z","title":"Veon: V ocabulary- enhanced occupancy prediction","venue":null,"work_id":"7774ee29-e0ee-41b8-9c59-389a916a8f38","year":2025},"citing_paper":{"arxiv_id":"2502.04981","last_updated":"2025-08-02T11:08:33Z","snapshot_observed_at":"2026-08-18T20:26:42.380307Z","submitted_at":"2025-02-07T14:58:59Z","title":"AutoOcc: Automatic Open-Ended Semantic Occupancy Annotation via Vision-Language Guided Gaussian Splatting","version":3},"reference_index":66,"source":"pdf_text","source_observed_at":"2026-08-08T20:48:50.955773Z"},"links":{"citing_paper":"/paper/2502.04981"},"observation_digest":"sha256:a841505ea87b60437e4739460ee9c60e11136251b267f02939c2605e8b1d38e3","observation_id":"d262675d-9802-463a-a15d-684735b033e4","resolution":{"observed_at":"2026-08-08T20:48:51.204351Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T20:48:50.959250Z","title":"Drivinggaussian: Composite gaussian splatting for surrounding dynamic au- tonomous driving scenes","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2502.04981","last_updated":"2025-08-02T11:08:33Z","snapshot_observed_at":"2026-08-18T20:26:42.380307Z","submitted_at":"2025-02-07T14:58:59Z","title":"AutoOcc: Automatic Open-Ended Semantic Occupancy Annotation via Vision-Language Guided Gaussian Splatting","version":3},"reference_index":67,"source":"pdf_text","source_observed_at":"2026-08-08T20:48:50.959250Z"},"links":{"citing_paper":"/paper/2502.04981"},"observation_digest":"sha256:1e6edd9b55885c278ef1b130dc31174e2d93440911e0f92c0a1e0951109fb737","observation_id":"0b321e15-4d84-4612-a200-aa7d70e1dab3","resolution":{"observed_at":"2026-08-08T20:48:50.959250Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"paper":{"arxiv_id":"2502.04981","last_updated":"2025-08-02T11:08:33Z","latest_version":3,"primary_category":"cs.CV","snapshot_observed_at":"2026-08-18T20:26:42.380307Z","submitted_at":"2025-02-07T14:58:59Z","title":"AutoOcc: Automatic Open-Ended Semantic Occupancy Annotation via Vision-Language Guided Gaussian Splatting"},"reference_resolution":{"displayed":67,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":26,"verified_exact":1,"verified_fuzzy":40},"total_outbound_references":67},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"thesis":"As of 20 August 2026, this Paper Citation Record lists 67 of 67 outbound references and 3 inbound Pith citation observations for arXiv:2502.04981."}