{"as_of":"2026-08-17T00:22:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:ba28253c0314c714dbb7e76f3d52f95d179ca0c48337e61f0ac4942fd3d60e68","coverage":[{"denominator":54,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":54,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-04T20:49:00.822248Z","state":"measured"},{"denominator":54,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":54,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-16T06:30:59.297886+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2509.08388/citation-record","integrity":"/paper/2509.08388/integrity","json":"/paper/2509.08388/citation-record.json","paper":"/paper/2509.08388"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T20:49:07.922236Z","title":"Se- mantickitti: A dataset for semantic scene understanding of lidar sequences","venue":null,"work_id":"0687c71c-5713-4948-8add-6a6eec3d3ef0","year":null},"citing_paper":{"arxiv_id":"2509.08388","last_updated":"2025-09-10T08:29:22Z","snapshot_observed_at":"2026-08-16T10:22:44.957047Z","submitted_at":"2025-09-10T08:29:22Z","title":"Semantic Causality-Aware Vision-Based 3D Occupancy Prediction","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-04T20:48:54.499137Z"},"links":{"citing_paper":"/paper/2509.08388"},"observation_digest":"sha256:e9c54d83317a7fe466588f4d4c0aceeab5eaaeb93e8608638fe257c2eac541e1","observation_id":"7dc1e200-9e37-4cb6-93e6-fd404e3bedfa","resolution":{"observed_at":"2026-08-04T20:49:07.937347Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2407.17310","last_updated":"2024-07-25T07:47:11Z","snapshot_observed_at":"2026-08-16T13:31:24.577469Z","submitted_at":"2024-07-24T14:22:55Z","title":"LangOcc: Self-Supervised Open Vocabulary Occupancy Estimation via Volume Rendering","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2407.17310","snapshot_observed_at":"2026-08-04T20:48:54.584442Z","title":"Lan- gocc: Self-supervised open vocabulary occupancy estima- tion via volume rendering.arXiv preprint arXiv:2407.17310,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2509.08388","last_updated":"2025-09-10T08:29:22Z","snapshot_observed_at":"2026-08-16T10:22:44.957047Z","submitted_at":"2025-09-10T08:29:22Z","title":"Semantic Causality-Aware Vision-Based 3D Occupancy Prediction","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-04T20:48:54.584442Z"},"links":{"cited_paper":"/paper/2407.17310","citing_paper":"/paper/2509.08388"},"observation_digest":"sha256:189bb3c41cd9939e8f47641d37c11614d098dc83841fed3b84d72b04bcb28c40","observation_id":"7a44f044-5c4f-4736-9862-cc643b104772","resolution":{"observed_at":"2026-08-04T20:48:54.584442Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2402.12792","last_updated":"2024-02-20T08:04:12Z","snapshot_observed_at":"2026-08-16T14:17:02.997248Z","submitted_at":"2024-02-20T08:04:12Z","title":"OccFlowNet: Towards Self-supervised Occupancy Estimation via Differentiable Rendering and Occupancy Flow","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.12792","snapshot_observed_at":"2026-08-04T20:48:54.724717Z","title":"Oc- cflownet: Towards self-supervised occupancy estimation via differentiable rendering and occupancy flow.arXiv preprint arXiv:2402.12792, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2509.08388","last_updated":"2025-09-10T08:29:22Z","snapshot_observed_at":"2026-08-16T10:22:44.957047Z","submitted_at":"2025-09-10T08:29:22Z","title":"Semantic Causality-Aware Vision-Based 3D Occupancy Prediction","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-04T20:48:54.724717Z"},"links":{"cited_paper":"/paper/2402.12792","citing_paper":"/paper/2509.08388"},"observation_digest":"sha256:1f9fb679c429bdd511b3b4a8b5c6687259aa9964524cda29a5ad1b82a5922b72","observation_id":"5e25ebf8-c0e2-4f0a-8999-267c2bb6e79a","resolution":{"observed_at":"2026-08-04T20:48:54.724717Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2502.17288","last_updated":"2025-08-25T07:44:26Z","snapshot_observed_at":"2026-08-16T12:55:41.299220Z","submitted_at":"2025-02-24T16:16:01Z","title":"GaussianFlowOcc: Sparse and Weakly Supervised Occupancy Estimation using Gaussian Splatting and Temporal Flow","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2502.17288","snapshot_observed_at":"2026-08-04T20:48:54.883942Z","title":"Gaussianflowocc: Sparse and weakly supervised occupancy estimation using gaussian splatting and temporal flow.arXiv preprint arXiv:2502.17288, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2509.08388","last_updated":"2025-09-10T08:29:22Z","snapshot_observed_at":"2026-08-16T10:22:44.957047Z","submitted_at":"2025-09-10T08:29:22Z","title":"Semantic Causality-Aware Vision-Based 3D Occupancy Prediction","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-04T20:48:54.883942Z"},"links":{"cited_paper":"/paper/2502.17288","citing_paper":"/paper/2509.08388"},"observation_digest":"sha256:4285b0405f6a67029b531fe291dbf0cdde111a811bfa2c73f4b40df5d9fa921b","observation_id":"225153c6-21d9-4dcf-b4fe-e50c2ad3967c","resolution":{"observed_at":"2026-08-04T20:48:54.883942Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T20:49:07.735467Z","title":"nuscenes: A multi- modal dataset for autonomous driving","venue":null,"work_id":"26f9cd89-f73d-44e4-929c-e4e8348b937a","year":2020},"citing_paper":{"arxiv_id":"2509.08388","last_updated":"2025-09-10T08:29:22Z","snapshot_observed_at":"2026-08-16T10:22:44.957047Z","submitted_at":"2025-09-10T08:29:22Z","title":"Semantic Causality-Aware Vision-Based 3D Occupancy Prediction","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-04T20:48:55.000701Z"},"links":{"citing_paper":"/paper/2509.08388"},"observation_digest":"sha256:9b93a42ee25f72534c03f9676e67b3a0f3e758e503a3e2c3c6c140886999b6ec","observation_id":"0eeb929b-bf4f-4a12-b3f9-c72d419e8339","resolution":{"observed_at":"2026-08-04T20:49:07.840074Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T20:49:07.588714Z","title":"Monoscene: Monoc- ular 3d semantic scene completion","venue":null,"work_id":"c74d0ff3-5cfc-4417-9ad8-4d4beee71b39","year":2022},"citing_paper":{"arxiv_id":"2509.08388","last_updated":"2025-09-10T08:29:22Z","snapshot_observed_at":"2026-08-16T10:22:44.957047Z","submitted_at":"2025-09-10T08:29:22Z","title":"Semantic Causality-Aware Vision-Based 3D Occupancy Prediction","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-04T20:48:55.178952Z"},"links":{"citing_paper":"/paper/2509.08388"},"observation_digest":"sha256:8311b08bace952ead45dff5a4f2f5f119f83a174ac84ca84ebe1ea07b37e0b48","observation_id":"8d3fa602-e7c6-40ea-afc5-2087447d870a","resolution":{"observed_at":"2026-08-04T20:49:07.630351Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2411.07725","last_updated":"2025-09-10T08:15:43Z","snapshot_observed_at":"2026-08-16T13:00:51.009969Z","submitted_at":"2024-11-12T11:32:56Z","title":"ALOcc: Adaptive Lifting-Based 3D Semantic Occupancy and Cost Volume-Based Flow Predictions","version":2},"cited_work":{"arxiv_id":"2411.07725","doi":null,"metadata_source":"pith","pith_arxiv_id":"2411.07725","snapshot_observed_at":"2026-08-04T20:49:02.319801Z","title":"ALOcc: Adaptive Lifting-Based 3D Semantic Occupancy and Cost Volume-Based Flow Predictions","venue":"cs.CV","work_id":"7a070979-18d8-4893-98a6-75950084f798","year":2024},"citing_paper":{"arxiv_id":"2509.08388","last_updated":"2025-09-10T08:29:22Z","snapshot_observed_at":"2026-08-16T10:22:44.957047Z","submitted_at":"2025-09-10T08:29:22Z","title":"Semantic Causality-Aware Vision-Based 3D Occupancy Prediction","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-04T20:48:55.236473Z"},"links":{"cited_paper":"/paper/2411.07725","citing_paper":"/paper/2509.08388"},"observation_digest":"sha256:e7de83f81e1c28c123edb481dc962319a40c75366a4a0b38fc461d5fc350f379","observation_id":"a6a7f8ec-50cc-4d7b-b18b-0388ea13cb2b","resolution":{"observed_at":"2026-08-04T20:49:02.433381Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2407.01436","last_updated":"2024-07-01T16:32:15Z","snapshot_observed_at":"2026-08-16T13:38:03.119308Z","submitted_at":"2024-07-01T16:32:15Z","title":"AdaOcc: Adaptive Forward View Transformation and Flow Modeling for 3D Occupancy and Flow Prediction","version":1},"cited_work":{"arxiv_id":"2407.01436","doi":null,"metadata_source":"pith","pith_arxiv_id":"2407.01436","snapshot_observed_at":"2026-08-04T20:49:02.167974Z","title":"AdaOcc: Adaptive Forward View Transformation and Flow Modeling for 3D Occupancy and Flow Prediction","venue":"cs.CV","work_id":"ffa6e815-8150-4b97-a31c-e518f8003f06","year":2024},"citing_paper":{"arxiv_id":"2509.08388","last_updated":"2025-09-10T08:29:22Z","snapshot_observed_at":"2026-08-16T10:22:44.957047Z","submitted_at":"2025-09-10T08:29:22Z","title":"Semantic Causality-Aware Vision-Based 3D Occupancy Prediction","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-04T20:48:55.347765Z"},"links":{"cited_paper":"/paper/2407.01436","citing_paper":"/paper/2509.08388"},"observation_digest":"sha256:4fd2f27778806dd4b6362732b89077a3fd9d2b448f458b0bfc13cac471946dd8","observation_id":"93d7f249-f69f-4a01-96e4-35847e10cd43","resolution":{"observed_at":"2026-08-04T20:49:02.227948Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T20:49:07.399342Z","title":"Rethinking temporal fusion with a unified gradient descent view for 3d semantic occupancy prediction","venue":null,"work_id":"16d1f5b3-3538-46e2-8099-3b01fec4f378","year":2025},"citing_paper":{"arxiv_id":"2509.08388","last_updated":"2025-09-10T08:29:22Z","snapshot_observed_at":"2026-08-16T10:22:44.957047Z","submitted_at":"2025-09-10T08:29:22Z","title":"Semantic Causality-Aware Vision-Based 3D Occupancy Prediction","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-04T20:48:55.493164Z"},"links":{"citing_paper":"/paper/2509.08388"},"observation_digest":"sha256:ec21345ebccf8d02fdbcf4392ed342f2c150021d7a293992d5bb14f95d2a3723","observation_id":"98d85e3c-4aac-42b2-82d7-292d24d29f00","resolution":{"observed_at":"2026-08-04T20:49:07.503123Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T20:49:07.218361Z","title":"3d sketch-aware semantic scene comple- tion via semi-supervised structure prior","venue":null,"work_id":"eaea5f05-01e7-4ab7-b8ef-2309209b14ab","year":2020},"citing_paper":{"arxiv_id":"2509.08388","last_updated":"2025-09-10T08:29:22Z","snapshot_observed_at":"2026-08-16T10:22:44.957047Z","submitted_at":"2025-09-10T08:29:22Z","title":"Semantic Causality-Aware Vision-Based 3D Occupancy Prediction","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-04T20:48:55.602300Z"},"links":{"citing_paper":"/paper/2509.08388"},"observation_digest":"sha256:e7bdfea6b13ad0e0bc87b9890cd269b7f2b4a24ffba2969c2110d076d81c0eab","observation_id":"b47a8d1b-2dd3-4299-bb32-bc3ff1c70237","resolution":{"observed_at":"2026-08-04T20:49:07.312926Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1908.02729","last_updated":"2019-08-07T17:04:26Z","snapshot_observed_at":"2026-08-15T00:47:18.395562Z","submitted_at":"2019-08-07T17:04:26Z","title":"Robust Learning with Jacobian Regularization","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1908.02729","snapshot_observed_at":"2026-08-04T20:48:55.744059Z","title":"Ro- bust learning with jacobian regularization.arXiv preprint arXiv:1908.02729, 2019","venue":null,"work_id":null,"year":1908},"citing_paper":{"arxiv_id":"2509.08388","last_updated":"2025-09-10T08:29:22Z","snapshot_observed_at":"2026-08-16T10:22:44.957047Z","submitted_at":"2025-09-10T08:29:22Z","title":"Semantic Causality-Aware Vision-Based 3D Occupancy Prediction","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-04T20:48:55.744059Z"},"links":{"cited_paper":"/paper/1908.02729","citing_paper":"/paper/2509.08388"},"observation_digest":"sha256:18ebfdccc925640e6f026eb05fffa8da09ca6116e5c9c2ae86c028d68a3eccd5","observation_id":"c52cad1b-51eb-4fe0-8f63-44a8216f63f3","resolution":{"observed_at":"2026-08-04T20:48:55.744059Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2203.17054","last_updated":"2022-06-16T09:44:08Z","snapshot_observed_at":"2026-08-16T17:10:15.129652Z","submitted_at":"2022-03-31T14:21:19Z","title":"BEVDet4D: Exploit Temporal Cues in Multi-camera 3D Object Detection","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2203.17054","snapshot_observed_at":"2026-08-04T20:48:55.880088Z","title":"Bevdet4d: Exploit tempo- ral cues in multi-camera 3d object detection.arXiv preprint arXiv:2203.17054, 2022","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2509.08388","last_updated":"2025-09-10T08:29:22Z","snapshot_observed_at":"2026-08-16T10:22:44.957047Z","submitted_at":"2025-09-10T08:29:22Z","title":"Semantic Causality-Aware Vision-Based 3D Occupancy Prediction","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-04T20:48:55.880088Z"},"links":{"cited_paper":"/paper/2203.17054","citing_paper":"/paper/2509.08388"},"observation_digest":"sha256:6967cf6530baff08fe5e77fde02c7505e567087dae75e5cf496696ca192c5f92","observation_id":"f8767f04-c054-408f-aea1-c1aaad7cb360","resolution":{"observed_at":"2026-08-04T20:48:55.880088Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2112.11790","last_updated":"2022-06-16T09:15:52Z","snapshot_observed_at":"2026-07-06T12:21:28.059661Z","submitted_at":"2021-12-22T10:48:06Z","title":"BEVDet: High-performance Multi-camera 3D Object Detection in Bird-Eye-View","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2112.11790","snapshot_observed_at":"2026-08-04T20:48:55.989005Z","title":"Bevdet: High-performance multi-camera 3d object de- tection in bird-eye-view.arXiv preprint arXiv:2112.11790,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2509.08388","last_updated":"2025-09-10T08:29:22Z","snapshot_observed_at":"2026-08-16T10:22:44.957047Z","submitted_at":"2025-09-10T08:29:22Z","title":"Semantic Causality-Aware Vision-Based 3D Occupancy Prediction","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-04T20:48:55.989005Z"},"links":{"cited_paper":"/paper/2112.11790","citing_paper":"/paper/2509.08388"},"observation_digest":"sha256:4f28ea016ee71794b89ffe3b29a630bb7204fe09d6a71d633270be33585cea21","observation_id":"d51538a2-2cba-4eef-95d9-6f6d7791bca1","resolution":{"observed_at":"2026-08-04T20:48:55.989005Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2302.07817","last_updated":"2023-03-02T16:41:45Z","snapshot_observed_at":"2026-08-16T15:55:05.947853Z","submitted_at":"2023-02-15T17:58:10Z","title":"Tri-Perspective View for Vision-Based 3D Semantic Occupancy Prediction","version":2},"cited_work":{"arxiv_id":"2302.07817","doi":null,"metadata_source":"pith","pith_arxiv_id":"2302.07817","snapshot_observed_at":"2026-08-04T20:49:01.928843Z","title":"Tri-Perspective View for Vision-Based 3D Semantic Occupancy Prediction","venue":"cs.CV","work_id":"ef633e9f-6e1a-4c7c-b1e0-88e7eb35e3c3","year":2023},"citing_paper":{"arxiv_id":"2509.08388","last_updated":"2025-09-10T08:29:22Z","snapshot_observed_at":"2026-08-16T10:22:44.957047Z","submitted_at":"2025-09-10T08:29:22Z","title":"Semantic Causality-Aware Vision-Based 3D Occupancy Prediction","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-04T20:48:56.156376Z"},"links":{"cited_paper":"/paper/2302.07817","citing_paper":"/paper/2509.08388"},"observation_digest":"sha256:91ada663cfa1b9227b8adeb8b7048addf017d8e9223ffddc7faca42521c46df8","observation_id":"5b036131-eccb-4e53-975a-0f71c15ef72a","resolution":{"observed_at":"2026-08-04T20:49:02.026240Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T20:49:06.955333Z","title":"Selfocc: Self-supervised vision-based 3d oc- cupancy prediction","venue":null,"work_id":"307f4795-300f-45c5-bb60-58b8e0db9aee","year":2024},"citing_paper":{"arxiv_id":"2509.08388","last_updated":"2025-09-10T08:29:22Z","snapshot_observed_at":"2026-08-16T10:22:44.957047Z","submitted_at":"2025-09-10T08:29:22Z","title":"Semantic Causality-Aware Vision-Based 3D Occupancy Prediction","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-04T20:48:56.363220Z"},"links":{"citing_paper":"/paper/2509.08388"},"observation_digest":"sha256:f5158ea6914f451e4b154d856bc20429d950245ea85be111e9c9f643b6997d7a","observation_id":"838f42f5-08be-4ecb-b02a-496a4030c8a4","resolution":{"observed_at":"2026-08-04T20:49:07.112428Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T20:48:56.471770Z","title":"Gaussianformer: Scene as gaussians for vision-based 3d semantic occupancy prediction","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2509.08388","last_updated":"2025-09-10T08:29:22Z","snapshot_observed_at":"2026-08-16T10:22:44.957047Z","submitted_at":"2025-09-10T08:29:22Z","title":"Semantic Causality-Aware Vision-Based 3D Occupancy Prediction","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-04T20:48:56.471770Z"},"links":{"citing_paper":"/paper/2509.08388"},"observation_digest":"sha256:bc9e5981e2b197402a42f5e4b48f2df30d47d14cf828f05b4f2f4303b617e492","observation_id":"0b6ec050-8d7e-48ce-811c-48ff668bdfd7","resolution":{"observed_at":"2026-08-04T20:48:56.471770Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2412.13193","last_updated":"2025-03-24T12:45:56Z","snapshot_observed_at":"2026-08-13T10:33:17.381595Z","submitted_at":"2024-12-17T18:59:46Z","title":"GaussTR: Foundation Model-Aligned Gaussian Transformer for Self-Supervised 3D Spatial Understanding","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2412.13193","snapshot_observed_at":"2026-08-04T20:48:56.621340Z","title":"Gausstr: Foundation model-aligned gaussian transformer for self-supervised 3d spatial understanding.arXiv preprint arXiv:2412.13193, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2509.08388","last_updated":"2025-09-10T08:29:22Z","snapshot_observed_at":"2026-08-16T10:22:44.957047Z","submitted_at":"2025-09-10T08:29:22Z","title":"Semantic Causality-Aware Vision-Based 3D Occupancy Prediction","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-04T20:48:56.621340Z"},"links":{"cited_paper":"/paper/2412.13193","citing_paper":"/paper/2509.08388"},"observation_digest":"sha256:7d5c7035559b6e83b965a8629b881e0f2a17cd6783c2cc06d0f134dfcd428874","observation_id":"54930c2a-cac2-4462-8824-bc3d6047ecfc","resolution":{"observed_at":"2026-08-04T20:48:56.621340Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T20:49:06.724820Z","title":"Layercam: Exploring hierarchical class activation maps for localization.IEEE Transactions on Image Processing, 30:5875–5888, 2021","venue":null,"work_id":"e8395fd3-013c-4cc9-bd87-aa5aa7b68594","year":2021},"citing_paper":{"arxiv_id":"2509.08388","last_updated":"2025-09-10T08:29:22Z","snapshot_observed_at":"2026-08-16T10:22:44.957047Z","submitted_at":"2025-09-10T08:29:22Z","title":"Semantic Causality-Aware Vision-Based 3D Occupancy Prediction","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-04T20:48:56.745577Z"},"links":{"citing_paper":"/paper/2509.08388"},"observation_digest":"sha256:8b22aa853d23b7f995d331417bada0b10f52774ab056081aee2320f1c6a5e190","observation_id":"11fce7a5-a896-4d12-9ac4-e6b502fa9675","resolution":{"observed_at":"2026-08-04T20:49:06.837693Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2412.08774","last_updated":"2025-02-27T11:57:16Z","snapshot_observed_at":"2026-08-13T15:45:26.041415Z","submitted_at":"2024-12-11T20:55:21Z","title":"ProtoOcc: Accurate, Efficient 3D Occupancy Prediction Using Dual Branch Encoder-Prototype Query Decoder","version":2},"cited_work":{"arxiv_id":"2412.08774","doi":null,"metadata_source":"pith","pith_arxiv_id":"2412.08774","snapshot_observed_at":"2026-08-04T20:49:01.755160Z","title":"ProtoOcc: Accurate, Efficient 3D Occupancy Prediction Using Dual Branch Encoder-Prototype Query Decoder","venue":"cs.CV","work_id":"6a69b7c9-832a-48c9-93ed-0b2223e0601d","year":2024},"citing_paper":{"arxiv_id":"2509.08388","last_updated":"2025-09-10T08:29:22Z","snapshot_observed_at":"2026-08-16T10:22:44.957047Z","submitted_at":"2025-09-10T08:29:22Z","title":"Semantic Causality-Aware Vision-Based 3D Occupancy Prediction","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-04T20:48:56.903171Z"},"links":{"cited_paper":"/paper/2412.08774","citing_paper":"/paper/2509.08388"},"observation_digest":"sha256:9d53bd736c9a3146ff2cdd133a6081d409f4ff71072b7b053eecce36f0e94492","observation_id":"68be6329-f766-42fb-8bfb-cd2b1dd572a1","resolution":{"observed_at":"2026-08-04T20:49:01.835195Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T20:49:06.542180Z","title":"Rgbd based dimensional decomposition residual network for 3d semantic scene completion","venue":null,"work_id":"50283acb-2644-41a2-95b0-1661c96dbbb1","year":2019},"citing_paper":{"arxiv_id":"2509.08388","last_updated":"2025-09-10T08:29:22Z","snapshot_observed_at":"2026-08-16T10:22:44.957047Z","submitted_at":"2025-09-10T08:29:22Z","title":"Semantic Causality-Aware Vision-Based 3D Occupancy Prediction","version":1},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-04T20:48:57.007722Z"},"links":{"citing_paper":"/paper/2509.08388"},"observation_digest":"sha256:404d0966cc554d19fff1852c4602ddd4119e55d07a79bb100684ebbda5363202","observation_id":"0dca0488-a8ab-4efc-b4cb-f1d522cd1ac0","resolution":{"observed_at":"2026-08-04T20:49:06.587757Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T20:49:06.416823Z","title":"Viewformer: Exploring spatiotem- poral modeling for multi-view 3d occupancy perception via view-guided transformers","venue":null,"work_id":"21fc3eec-4744-4702-8c64-9de9851d659f","year":2024},"citing_paper":{"arxiv_id":"2509.08388","last_updated":"2025-09-10T08:29:22Z","snapshot_observed_at":"2026-08-16T10:22:44.957047Z","submitted_at":"2025-09-10T08:29:22Z","title":"Semantic Causality-Aware Vision-Based 3D Occupancy Prediction","version":1},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-04T20:48:57.124768Z"},"links":{"citing_paper":"/paper/2509.08388"},"observation_digest":"sha256:9a6ff022aff036dd39264d27f738bc15a6941c9dbe79fb13419cde4521ebd4ba","observation_id":"bef9fe0b-2813-4365-b932-b0e7635f5ef5","resolution":{"observed_at":"2026-08-04T20:49:06.481339Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2206.10092","last_updated":"2022-11-30T11:28:11Z","snapshot_observed_at":"2026-08-16T16:51:37.024159Z","submitted_at":"2022-06-21T03:21:18Z","title":"BEVDepth: Acquisition of Reliable Depth for Multi-view 3D Object Detection","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2206.10092","snapshot_observed_at":"2026-08-04T20:48:57.186218Z","title":"Bevdepth: Acquisition of reliable depth for multi-view 3d object detec- tion.arXiv preprint arXiv:2206.10092, 2022","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2509.08388","last_updated":"2025-09-10T08:29:22Z","snapshot_observed_at":"2026-08-16T10:22:44.957047Z","submitted_at":"2025-09-10T08:29:22Z","title":"Semantic Causality-Aware Vision-Based 3D Occupancy Prediction","version":1},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-04T20:48:57.186218Z"},"links":{"cited_paper":"/paper/2206.10092","citing_paper":"/paper/2509.08388"},"observation_digest":"sha256:268b3bd553bae7db2549d034081f71774ec2c37e84672039dc650b9b2177a231","observation_id":"9d954fb7-7b22-4771-9ef7-3c2de795647e","resolution":{"observed_at":"2026-08-04T20:48:57.186218Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T20:49:06.147987Z","title":"Bevstereo: Enhancing depth estimation in multi-view 3d object detection with temporal stereo","venue":null,"work_id":"79656281-a6a4-454a-847f-ca986bdcc711","year":2023},"citing_paper":{"arxiv_id":"2509.08388","last_updated":"2025-09-10T08:29:22Z","snapshot_observed_at":"2026-08-16T10:22:44.957047Z","submitted_at":"2025-09-10T08:29:22Z","title":"Semantic Causality-Aware Vision-Based 3D Occupancy Prediction","version":1},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-04T20:48:57.319353Z"},"links":{"citing_paper":"/paper/2509.08388"},"observation_digest":"sha256:9f05cbd9e2427f4398841ed63a8a73a2b21d3354ce4ac2c258e637a8e42be5a6","observation_id":"9eb4e4f9-34aa-4efd-8418-0c3309bb06f2","resolution":{"observed_at":"2026-08-04T20:49:06.267480Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T20:49:05.902789Z","title":"V oxformer: Sparse voxel transformer for camera- based 3d semantic scene completion","venue":null,"work_id":"6ce6b0f2-e26b-4c73-8eec-148ff2b62802","year":2023},"citing_paper":{"arxiv_id":"2509.08388","last_updated":"2025-09-10T08:29:22Z","snapshot_observed_at":"2026-08-16T10:22:44.957047Z","submitted_at":"2025-09-10T08:29:22Z","title":"Semantic Causality-Aware Vision-Based 3D Occupancy Prediction","version":1},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-04T20:48:57.421830Z"},"links":{"citing_paper":"/paper/2509.08388"},"observation_digest":"sha256:3671a4bca2bfbe728783476892d590a117a3da77abc72f2f5c48571d0e044ed4","observation_id":"1edfbb9f-a5ff-4ed0-a327-c1d22306f0a8","resolution":{"observed_at":"2026-08-04T20:49:05.961251Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T20:49:05.621922Z","title":"Fast-bev: A fast and strong bird’s- eye view perception baseline.IEEE Transactions on Pattern Analysis and Machine Intelligence, 2024","venue":null,"work_id":"7574ea84-28a2-4a0a-908c-ab6f3565555c","year":2024},"citing_paper":{"arxiv_id":"2509.08388","last_updated":"2025-09-10T08:29:22Z","snapshot_observed_at":"2026-08-16T10:22:44.957047Z","submitted_at":"2025-09-10T08:29:22Z","title":"Semantic Causality-Aware Vision-Based 3D Occupancy Prediction","version":1},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-08-04T20:48:57.512146Z"},"links":{"citing_paper":"/paper/2509.08388"},"observation_digest":"sha256:c0b8ac239a8509456832372a3366caf53f6177b3252055d8205da16441200886","observation_id":"6002a124-b07f-4420-9ad6-7280a4a3e744","resolution":{"observed_at":"2026-08-04T20:49:05.749588Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2203.17270","last_updated":"2022-07-13T06:57:28Z","snapshot_observed_at":"2026-08-16T21:18:10.684128Z","submitted_at":"2022-03-31T17:59:01Z","title":"BEVFormer: Learning Bird's-Eye-View Representation from Multi-Camera Images via Spatiotemporal Transformers","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2203.17270","snapshot_observed_at":"2026-08-04T20:48:57.622231Z","title":"Bevformer: Learning bird’s-eye-view representation from multi-camera images via spatiotemporal transformers.arXiv preprint arXiv:2203.17270, 2022","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2509.08388","last_updated":"2025-09-10T08:29:22Z","snapshot_observed_at":"2026-08-16T10:22:44.957047Z","submitted_at":"2025-09-10T08:29:22Z","title":"Semantic Causality-Aware Vision-Based 3D Occupancy Prediction","version":1},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-08-04T20:48:57.622231Z"},"links":{"cited_paper":"/paper/2203.17270","citing_paper":"/paper/2509.08388"},"observation_digest":"sha256:405f506fefd1eca583b08351ae8bc76ba5a9aea4f3349bbc3f6b47e79a16f8b6","observation_id":"6ded0fc4-1f91-46a2-8582-bb5106ccb31b","resolution":{"observed_at":"2026-08-04T20:48:57.622231Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2307.01492","last_updated":"2023-07-04T05:55:54Z","snapshot_observed_at":"2026-08-16T15:18:56.935168Z","submitted_at":"2023-07-04T05:55:54Z","title":"FB-OCC: 3D Occupancy Prediction based on Forward-Backward View Transformation","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2307.01492","snapshot_observed_at":"2026-08-04T20:48:57.743557Z","title":"Fb-occ: 3d occupancy prediction based on forward-backward view transformation","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2509.08388","last_updated":"2025-09-10T08:29:22Z","snapshot_observed_at":"2026-08-16T10:22:44.957047Z","submitted_at":"2025-09-10T08:29:22Z","title":"Semantic Causality-Aware Vision-Based 3D Occupancy Prediction","version":1},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-08-04T20:48:57.743557Z"},"links":{"cited_paper":"/paper/2307.01492","citing_paper":"/paper/2509.08388"},"observation_digest":"sha256:bb7329ab97ac7af2795cf29bd9c7a4788feaf6fa03fc76da49a4b198c08a8fb0","observation_id":"0dc3bfe8-710c-4869-85a0-9c839baa9086","resolution":{"observed_at":"2026-08-04T20:48:57.743557Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T20:49:05.406502Z","title":"Fb-bev: Bev representation from forward-backward view transformations","venue":null,"work_id":"590c2f4e-dbf9-441a-9471-c47a42c5e439","year":2023},"citing_paper":{"arxiv_id":"2509.08388","last_updated":"2025-09-10T08:29:22Z","snapshot_observed_at":"2026-08-16T10:22:44.957047Z","submitted_at":"2025-09-10T08:29:22Z","title":"Semantic Causality-Aware Vision-Based 3D Occupancy Prediction","version":1},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-08-04T20:48:57.906142Z"},"links":{"citing_paper":"/paper/2509.08388"},"observation_digest":"sha256:1d54c251decd9769131e0087d35f1bd07d6012d7ab5630dfe6540008b160b938","observation_id":"9df8f515-28a9-407e-9696-75871fd81937","resolution":{"observed_at":"2026-08-04T20:49:05.465911Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T20:49:05.157524Z","title":"Cascadeflow: 3d occupancy and flow prediction with cascaded sparsity sampling refine- ment framework.CVPR 2024 Autonomous Grand Challenge Track On Occupancy and Flow, 2024","venue":null,"work_id":"8823023e-4b69-4ab5-8700-9b42ea25573a","year":2024},"citing_paper":{"arxiv_id":"2509.08388","last_updated":"2025-09-10T08:29:22Z","snapshot_observed_at":"2026-08-16T10:22:44.957047Z","submitted_at":"2025-09-10T08:29:22Z","title":"Semantic Causality-Aware Vision-Based 3D Occupancy Prediction","version":1},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-08-04T20:48:58.028676Z"},"links":{"citing_paper":"/paper/2509.08388"},"observation_digest":"sha256:b58dbd46aab6b24d70c733b49f397f3c63f8c3d5e9c327d5880a5c71c54098c8","observation_id":"6eecf2c2-2049-4f2f-9596-b42862eec58d","resolution":{"observed_at":"2026-08-04T20:49:05.229285Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T20:49:04.905234Z","title":"Fully sparse 3d occupancy prediction","venue":null,"work_id":"bad241c5-7e6f-4ebf-b9d5-780b4f3a82bb","year":null},"citing_paper":{"arxiv_id":"2509.08388","last_updated":"2025-09-10T08:29:22Z","snapshot_observed_at":"2026-08-16T10:22:44.957047Z","submitted_at":"2025-09-10T08:29:22Z","title":"Semantic Causality-Aware Vision-Based 3D Occupancy Prediction","version":1},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-08-04T20:48:58.197965Z"},"links":{"citing_paper":"/paper/2509.08388"},"observation_digest":"sha256:793dff98961a54066ca7f67961ff646fe9704c2b457d0a4b463119b14ec5db65","observation_id":"b552b499-ecfa-4389-a7ae-4232f04b8221","resolution":{"observed_at":"2026-08-04T20:49:04.963653Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T20:49:04.705903Z","title":"Surroundsdf: Implicit 3d scene understanding based on signed distance field","venue":null,"work_id":"fb95f5ed-6bac-4257-825a-b25d1b562965","year":2024},"citing_paper":{"arxiv_id":"2509.08388","last_updated":"2025-09-10T08:29:22Z","snapshot_observed_at":"2026-08-16T10:22:44.957047Z","submitted_at":"2025-09-10T08:29:22Z","title":"Semantic Causality-Aware Vision-Based 3D Occupancy Prediction","version":1},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-08-04T20:48:58.309943Z"},"links":{"citing_paper":"/paper/2509.08388"},"observation_digest":"sha256:8a38081e5519e561baa570cd61275a2ac121a1821c91f24a8a43bc61d9849d97","observation_id":"5ae28ea3-d4b0-4cef-8079-bec11dab974c","resolution":{"observed_at":"2026-08-04T20:49:04.842739Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T20:49:04.521606Z","title":"See and think: Disentangling semantic scene completion.Advances in Neural Information Processing Systems, 31, 2018","venue":null,"work_id":"2a2bf09b-5680-4397-a7d5-5e67a4669e68","year":2018},"citing_paper":{"arxiv_id":"2509.08388","last_updated":"2025-09-10T08:29:22Z","snapshot_observed_at":"2026-08-16T10:22:44.957047Z","submitted_at":"2025-09-10T08:29:22Z","title":"Semantic Causality-Aware Vision-Based 3D Occupancy Prediction","version":1},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-08-04T20:48:58.473981Z"},"links":{"citing_paper":"/paper/2509.08388"},"observation_digest":"sha256:69543da6c8a57606558a6818702b35497e48a61cd8bcf23ffca8d02348b11948","observation_id":"aeef4879-a272-49ce-b422-adde14d73d70","resolution":{"observed_at":"2026-08-04T20:49:04.584167Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2407.07587","last_updated":"2024-10-08T11:07:08Z","snapshot_observed_at":"2026-08-16T13:35:27.823891Z","submitted_at":"2024-07-10T12:20:11Z","title":"Let Occ Flow: Self-Supervised 3D Occupancy Flow Prediction","version":3},"cited_work":{"arxiv_id":"2407.07587","doi":null,"metadata_source":"pith","pith_arxiv_id":"2407.07587","snapshot_observed_at":"2026-08-04T20:49:01.537365Z","title":"Let Occ Flow: Self-Supervised 3D Occupancy Flow Prediction","venue":"cs.CV","work_id":"66f539b3-07f7-40c1-8538-21298005ee5f","year":2024},"citing_paper":{"arxiv_id":"2509.08388","last_updated":"2025-09-10T08:29:22Z","snapshot_observed_at":"2026-08-16T10:22:44.957047Z","submitted_at":"2025-09-10T08:29:22Z","title":"Semantic Causality-Aware Vision-Based 3D Occupancy Prediction","version":1},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-08-04T20:48:58.591854Z"},"links":{"cited_paper":"/paper/2407.07587","citing_paper":"/paper/2509.08388"},"observation_digest":"sha256:376ee04c6dfb2a0d8f458a37c7a77059f23207bd0a5e8b063f0d31d195d99ed5","observation_id":"dd512924-6502-4325-baf3-0ca6b2a411e2","resolution":{"observed_at":"2026-08-04T20:49:01.586477Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1711.05101","last_updated":"2019-01-04T21:01:49Z","snapshot_observed_at":"2026-08-14T20:13:52.872565Z","submitted_at":"2017-11-14T14:24:06Z","title":"Decoupled Weight Decay Regularization","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1711.05101","snapshot_observed_at":"2026-08-04T20:48:58.682573Z","title":"Fixing weight decay regularization in adam.arXiv preprint arXiv:1711.05101,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2509.08388","last_updated":"2025-09-10T08:29:22Z","snapshot_observed_at":"2026-08-16T10:22:44.957047Z","submitted_at":"2025-09-10T08:29:22Z","title":"Semantic Causality-Aware Vision-Based 3D Occupancy Prediction","version":1},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-08-04T20:48:58.682573Z"},"links":{"cited_paper":"/paper/1711.05101","citing_paper":"/paper/2509.08388"},"observation_digest":"sha256:8bd43922e6ed0f15910d5565d90647de324d4fc3c7e54ca2c8f38df9db35de03","observation_id":"93ee509b-0074-47a7-a9df-06223fd3c163","resolution":{"observed_at":"2026-08-04T20:48:58.682573Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2312.03774","last_updated":"2024-03-19T05:03:18Z","snapshot_observed_at":"2026-08-16T14:37:17.411318Z","submitted_at":"2023-12-06T02:52:54Z","title":"OctreeOcc: Efficient and Multi-Granularity Occupancy Prediction Using Octree Queries","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2312.03774","snapshot_observed_at":"2026-08-04T20:48:58.855288Z","title":"Oc- treeocc: Efficient and multi-granularity occupancy predic- tion using octree queries.arXiv preprint arXiv:2312.03774,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2509.08388","last_updated":"2025-09-10T08:29:22Z","snapshot_observed_at":"2026-08-16T10:22:44.957047Z","submitted_at":"2025-09-10T08:29:22Z","title":"Semantic Causality-Aware Vision-Based 3D Occupancy Prediction","version":1},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-08-04T20:48:58.855288Z"},"links":{"cited_paper":"/paper/2312.03774","citing_paper":"/paper/2509.08388"},"observation_digest":"sha256:3082f5906d9e0fb94d1d00716de49e81c070de0bdd6edc609b823cbcc29da1b5","observation_id":"7808cc04-6f13-45f5-9775-b584ce46fbc2","resolution":{"observed_at":"2026-08-04T20:48:58.855288Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2312.01919","last_updated":"2024-04-11T10:38:33Z","snapshot_observed_at":"2026-08-16T14:37:51.412370Z","submitted_at":"2023-12-04T14:23:18Z","title":"COTR: Compact Occupancy TRansformer for Vision-based 3D Occupancy Prediction","version":2},"cited_work":{"arxiv_id":"2312.01919","doi":null,"metadata_source":"pith","pith_arxiv_id":"2312.01919","snapshot_observed_at":"2026-08-04T20:49:01.295512Z","title":"COTR: Compact Occupancy TRansformer for Vision-based 3D Occupancy Prediction","venue":"cs.CV","work_id":"debe44a9-cc7e-4c1d-b53f-316776f3031f","year":2023},"citing_paper":{"arxiv_id":"2509.08388","last_updated":"2025-09-10T08:29:22Z","snapshot_observed_at":"2026-08-16T10:22:44.957047Z","submitted_at":"2025-09-10T08:29:22Z","title":"Semantic Causality-Aware Vision-Based 3D Occupancy Prediction","version":1},"reference_index":36,"source":"pdf_text","source_observed_at":"2026-08-04T20:48:58.958361Z"},"links":{"cited_paper":"/paper/2312.01919","citing_paper":"/paper/2509.08388"},"observation_digest":"sha256:ca9b899d6e5735622e6b0fce1bbb8ec26ecdb49828c5ed0325e63f870d0dcd2c","observation_id":"4d017477-cada-4500-988f-f61c8a86c1d5","resolution":{"observed_at":"2026-08-04T20:49:01.362499Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T20:49:04.358323Z","title":"Renderocc: Vision-centric 3d occupancy pre- diction with 2d rendering supervision","venue":null,"work_id":"a5f101ca-7659-41b3-9767-b7d2f593f5fe","year":2024},"citing_paper":{"arxiv_id":"2509.08388","last_updated":"2025-09-10T08:29:22Z","snapshot_observed_at":"2026-08-16T10:22:44.957047Z","submitted_at":"2025-09-10T08:29:22Z","title":"Semantic Causality-Aware Vision-Based 3D Occupancy Prediction","version":1},"reference_index":37,"source":"pdf_text","source_observed_at":"2026-08-04T20:48:59.077255Z"},"links":{"citing_paper":"/paper/2509.08388"},"observation_digest":"sha256:69bad20ccd95057a3a4c36bec9e82ffd123310f5bbe518aa650d41a60931b10c","observation_id":"94e6b481-8b51-4fba-945e-01054b250c8b","resolution":{"observed_at":"2026-08-04T20:49:04.417130Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T20:49:04.160550Z","title":"Lift, splat, shoot: Encod- ing images from arbitrary camera rigs by implicitly unpro- jecting to 3d","venue":null,"work_id":"ce3bf7f1-2bbb-4c02-8719-dbf779a80a18","year":2020},"citing_paper":{"arxiv_id":"2509.08388","last_updated":"2025-09-10T08:29:22Z","snapshot_observed_at":"2026-08-16T10:22:44.957047Z","submitted_at":"2025-09-10T08:29:22Z","title":"Semantic Causality-Aware Vision-Based 3D Occupancy Prediction","version":1},"reference_index":38,"source":"pdf_text","source_observed_at":"2026-08-04T20:48:59.194319Z"},"links":{"citing_paper":"/paper/2509.08388"},"observation_digest":"sha256:215ad314dde7a28b15187936af41cc9b5aa0df844d42f5ff63d1a447c3344102","observation_id":"2d45f1c1-b8fc-42ce-89f9-4b9c5cafee62","resolution":{"observed_at":"2026-08-04T20:49:04.216600Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T20:49:03.921268Z","title":"Occupancy as set of points","venue":null,"work_id":"8ae46d89-0cd6-45db-b5fd-1e79b7413a28","year":2024},"citing_paper":{"arxiv_id":"2509.08388","last_updated":"2025-09-10T08:29:22Z","snapshot_observed_at":"2026-08-16T10:22:44.957047Z","submitted_at":"2025-09-10T08:29:22Z","title":"Semantic Causality-Aware Vision-Based 3D Occupancy Prediction","version":1},"reference_index":39,"source":"pdf_text","source_observed_at":"2026-08-04T20:48:59.310623Z"},"links":{"citing_paper":"/paper/2509.08388"},"observation_digest":"sha256:2cad527fa479a86554965868197d378a71a5a551a64af76892fec73bb7625e3b","observation_id":"ddb48f7d-3e1d-44fa-87a5-2c8be61991a4","resolution":{"observed_at":"2026-08-04T20:49:04.023636Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T20:49:03.538024Z","title":"Occ3d: A large-scale 3d occupancy prediction benchmark for autonomous driving.Advances in Neural Information Processing Systems, 36, 2024","venue":null,"work_id":"1836f7d6-f08a-4ab6-9d81-8494f7aa03fa","year":2024},"citing_paper":{"arxiv_id":"2509.08388","last_updated":"2025-09-10T08:29:22Z","snapshot_observed_at":"2026-08-16T10:22:44.957047Z","submitted_at":"2025-09-10T08:29:22Z","title":"Semantic Causality-Aware Vision-Based 3D Occupancy Prediction","version":1},"reference_index":40,"source":"pdf_text","source_observed_at":"2026-08-04T20:48:59.414868Z"},"links":{"citing_paper":"/paper/2509.08388"},"observation_digest":"sha256:792ec30a25aaae02fa769e481f641a749f6b4252ee334ca319d9127ed2116ab3","observation_id":"513b1713-1df3-4b59-baf7-eff3deff1213","resolution":{"observed_at":"2026-08-04T20:49:03.649569Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T20:49:03.241389Z","title":"Scene as occupancy","venue":null,"work_id":"f72ab372-622c-400b-96a3-78c5acd39cf1","year":2023},"citing_paper":{"arxiv_id":"2509.08388","last_updated":"2025-09-10T08:29:22Z","snapshot_observed_at":"2026-08-16T10:22:44.957047Z","submitted_at":"2025-09-10T08:29:22Z","title":"Semantic Causality-Aware Vision-Based 3D Occupancy Prediction","version":1},"reference_index":41,"source":"pdf_text","source_observed_at":"2026-08-04T20:48:59.564782Z"},"links":{"citing_paper":"/paper/2509.08388"},"observation_digest":"sha256:4fce25e59dde0371d71051dbf4366f2886ed755786cc1d9c233d1f8d1b696ebe","observation_id":"df904d36-bfbc-4660-8fae-975dda9eeff3","resolution":{"observed_at":"2026-08-04T20:49:03.344583Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T20:48:59.718389Z","title":"Attention is all you need.Advances in neural information processing systems, 30, 2017","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2509.08388","last_updated":"2025-09-10T08:29:22Z","snapshot_observed_at":"2026-08-16T10:22:44.957047Z","submitted_at":"2025-09-10T08:29:22Z","title":"Semantic Causality-Aware Vision-Based 3D Occupancy Prediction","version":1},"reference_index":42,"source":"pdf_text","source_observed_at":"2026-08-04T20:48:59.718389Z"},"links":{"citing_paper":"/paper/2509.08388"},"observation_digest":"sha256:293648bca5d56e17cc851ae5fd54089a7ae835791f6293dec85b54bf52f678a6","observation_id":"b984d593-c73e-41d1-9536-2283ec3e6741","resolution":{"observed_at":"2026-08-04T20:48:59.718389Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2305.14160","last_updated":"2023-12-19T15:13:52Z","snapshot_observed_at":"2026-08-16T15:30:35.088717Z","submitted_at":"2023-05-23T15:26:20Z","title":"Label Words are Anchors: An Information Flow Perspective for Understanding In-Context Learning","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2305.14160","snapshot_observed_at":"2026-08-04T20:48:59.844453Z","title":"Label words are an- chors: An information flow perspective for understanding in-context learning.arXiv preprint arXiv:2305.14160, 2023","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2509.08388","last_updated":"2025-09-10T08:29:22Z","snapshot_observed_at":"2026-08-16T10:22:44.957047Z","submitted_at":"2025-09-10T08:29:22Z","title":"Semantic Causality-Aware Vision-Based 3D Occupancy Prediction","version":1},"reference_index":43,"source":"pdf_text","source_observed_at":"2026-08-04T20:48:59.844453Z"},"links":{"cited_paper":"/paper/2305.14160","citing_paper":"/paper/2509.08388"},"observation_digest":"sha256:ecdc6558944dc93c71ae787c5ccf894327fc11f2257e7515c5b7a6f3af5b960f","observation_id":"fe512cfd-54da-4499-9888-9700cd979881","resolution":{"observed_at":"2026-08-04T20:48:59.844453Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2303.03991","last_updated":"2023-03-07T15:43:39Z","snapshot_observed_at":"2026-08-16T15:50:06.141889Z","submitted_at":"2023-03-07T15:43:39Z","title":"OpenOccupancy: A Large Scale Benchmark for Surrounding Semantic Occupancy Perception","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2303.03991","snapshot_observed_at":"2026-08-04T20:48:59.913958Z","title":"Openoccupancy: A large scale benchmark for surrounding semantic occupancy perception.arXiv preprint arXiv:2303.03991, 2023","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2509.08388","last_updated":"2025-09-10T08:29:22Z","snapshot_observed_at":"2026-08-16T10:22:44.957047Z","submitted_at":"2025-09-10T08:29:22Z","title":"Semantic Causality-Aware Vision-Based 3D Occupancy Prediction","version":1},"reference_index":44,"source":"pdf_text","source_observed_at":"2026-08-04T20:48:59.913958Z"},"links":{"cited_paper":"/paper/2303.03991","citing_paper":"/paper/2509.08388"},"observation_digest":"sha256:5b95d5efdb447a30984ae6010669288ad83ef85bff331025152ca4f7b25d3e4f","observation_id":"046c0d9e-70d1-467c-9507-61bc66ccb0c0","resolution":{"observed_at":"2026-08-04T20:48:59.913958Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2303.09551","last_updated":"2023-08-27T15:33:19Z","snapshot_observed_at":"2026-08-16T15:47:36.891047Z","submitted_at":"2023-03-16T17:59:08Z","title":"SurroundOcc: Multi-Camera 3D Occupancy Prediction for Autonomous Driving","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2303.09551","snapshot_observed_at":"2026-08-04T20:48:59.984035Z","title":"Surroundocc: Multi-camera 3d oc- cupancy prediction for autonomous driving.arXiv preprint arXiv:2303.09551, 2023","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2509.08388","last_updated":"2025-09-10T08:29:22Z","snapshot_observed_at":"2026-08-16T10:22:44.957047Z","submitted_at":"2025-09-10T08:29:22Z","title":"Semantic Causality-Aware Vision-Based 3D Occupancy Prediction","version":1},"reference_index":45,"source":"pdf_text","source_observed_at":"2026-08-04T20:48:59.984035Z"},"links":{"cited_paper":"/paper/2303.09551","citing_paper":"/paper/2509.08388"},"observation_digest":"sha256:3d28659afa9d0390a0ba77a6614be96a95ea19e9cec7e786ba35ec7bf8434d97","observation_id":"29bb6d8d-7190-4750-ba1a-a677d9418fae","resolution":{"observed_at":"2026-08-04T20:48:59.984035Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2409.07972","last_updated":"2025-03-04T12:53:32Z","snapshot_observed_at":"2026-08-16T13:19:10.149453Z","submitted_at":"2024-09-12T12:12:19Z","title":"Deep Height Decoupling for Precise Vision-based 3D Occupancy Prediction","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2409.07972","snapshot_observed_at":"2026-08-04T20:49:00.138246Z","title":"Deep height decoupling for pre- cise vision-based 3d occupancy prediction.arXiv preprint arXiv:2409.07972, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2509.08388","last_updated":"2025-09-10T08:29:22Z","snapshot_observed_at":"2026-08-16T10:22:44.957047Z","submitted_at":"2025-09-10T08:29:22Z","title":"Semantic Causality-Aware Vision-Based 3D Occupancy Prediction","version":1},"reference_index":46,"source":"pdf_text","source_observed_at":"2026-08-04T20:49:00.138246Z"},"links":{"cited_paper":"/paper/2409.07972","citing_paper":"/paper/2509.08388"},"observation_digest":"sha256:c1e56f8a447c3c15a80b67809d276dc324ea9022efcdf5fd8a82fba077150703","observation_id":"287fdb31-db83-4a27-a59a-12204c2f1a27","resolution":{"observed_at":"2026-08-04T20:49:00.138246Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2409.11356","last_updated":"2025-02-13T05:20:48Z","snapshot_observed_at":"2026-08-16T13:17:45.258097Z","submitted_at":"2024-09-17T17:00:52Z","title":"RenderWorld: World Model with Self-Supervised 3D Label","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2409.11356","snapshot_observed_at":"2026-08-04T20:49:00.193227Z","title":"Renderworld: World model with self-supervised 3d label.arXiv preprint arXiv:2409.11356,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2509.08388","last_updated":"2025-09-10T08:29:22Z","snapshot_observed_at":"2026-08-16T10:22:44.957047Z","submitted_at":"2025-09-10T08:29:22Z","title":"Semantic Causality-Aware Vision-Based 3D Occupancy Prediction","version":1},"reference_index":47,"source":"pdf_text","source_observed_at":"2026-08-04T20:49:00.193227Z"},"links":{"cited_paper":"/paper/2409.11356","citing_paper":"/paper/2509.08388"},"observation_digest":"sha256:1055533b8a1579f00903ceb25dcc6c9946d750821856407398f23bdaf51702ff","observation_id":"5ea04341-28ea-447d-b6c1-799087b87a69","resolution":{"observed_at":"2026-08-04T20:49:00.193227Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T20:49:03.008795Z","title":"Seman- tic 3d occupancy mapping through efficient high order crfs","venue":null,"work_id":"a8098529-b92b-43a8-aa6f-6b6d807e6b15","year":2017},"citing_paper":{"arxiv_id":"2509.08388","last_updated":"2025-09-10T08:29:22Z","snapshot_observed_at":"2026-08-16T10:22:44.957047Z","submitted_at":"2025-09-10T08:29:22Z","title":"Semantic Causality-Aware Vision-Based 3D Occupancy Prediction","version":1},"reference_index":48,"source":"pdf_text","source_observed_at":"2026-08-04T20:49:00.324745Z"},"links":{"citing_paper":"/paper/2509.08388"},"observation_digest":"sha256:c649ab2fef37ecf4dfb1e7668ec3aec1417fb8b39df7a0a2d5de0ff93788994d","observation_id":"e425e5cb-4ead-4684-b53f-a1be186e896c","resolution":{"observed_at":"2026-08-04T20:49:03.060651Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2311.12058","last_updated":"2023-11-18T15:28:09Z","snapshot_observed_at":"2026-08-16T14:42:10.713390Z","submitted_at":"2023-11-18T15:28:09Z","title":"FlashOcc: Fast and Memory-Efficient Occupancy Prediction via Channel-to-Height Plugin","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2311.12058","snapshot_observed_at":"2026-08-04T20:49:00.371105Z","title":"Flashocc: Fast and memory-efficient occupancy prediction via channel-to-height plugin.arXiv preprint arXiv:2311.12058, 2023","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2509.08388","last_updated":"2025-09-10T08:29:22Z","snapshot_observed_at":"2026-08-16T10:22:44.957047Z","submitted_at":"2025-09-10T08:29:22Z","title":"Semantic Causality-Aware Vision-Based 3D Occupancy Prediction","version":1},"reference_index":49,"source":"pdf_text","source_observed_at":"2026-08-04T20:49:00.371105Z"},"links":{"cited_paper":"/paper/2311.12058","citing_paper":"/paper/2509.08388"},"observation_digest":"sha256:90d2f7a15b770729850f8ceab08645826d673eede581b1f9e2da60d9a8be509e","observation_id":"57694599-9560-4a65-a03d-50eefd6d8eda","resolution":{"observed_at":"2026-08-04T20:49:00.371105Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2312.09243","last_updated":"2024-08-21T12:24:49Z","snapshot_observed_at":"2026-08-16T14:34:38.939009Z","submitted_at":"2023-12-14T18:58:52Z","title":"OccNeRF: Advancing 3D Occupancy Prediction in LiDAR-Free Environments","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2312.09243","snapshot_observed_at":"2026-08-04T20:49:00.461114Z","title":"Occnerf: Self- supervised multi-camera occupancy prediction with neural radiance fields.arXiv preprint arXiv:2312.09243, 2023","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2509.08388","last_updated":"2025-09-10T08:29:22Z","snapshot_observed_at":"2026-08-16T10:22:44.957047Z","submitted_at":"2025-09-10T08:29:22Z","title":"Semantic Causality-Aware Vision-Based 3D Occupancy Prediction","version":1},"reference_index":50,"source":"pdf_text","source_observed_at":"2026-08-04T20:49:00.461114Z"},"links":{"cited_paper":"/paper/2312.09243","citing_paper":"/paper/2509.08388"},"observation_digest":"sha256:e1703892d6bde1e7b0e25aabf0d9d6ce5cf2ed2ddb6f6338f4fe886990a5d875","observation_id":"3a1d3050-d290-4fdf-9c96-7d8ff15c1c61","resolution":{"observed_at":"2026-08-04T20:49:00.461114Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2412.05976","last_updated":"2026-06-21T15:24:02Z","snapshot_observed_at":"2026-08-11T20:06:13.348654Z","submitted_at":"2024-12-08T15:49:35Z","title":"LightOcc: Lightweight Spatial Embedding for Efficient Vision-based 3D Occupancy Prediction","version":2},"cited_work":{"arxiv_id":"2412.05976","doi":null,"metadata_source":"pith","pith_arxiv_id":"2412.05976","snapshot_observed_at":"2026-08-04T20:49:00.965060Z","title":"LightOcc: Lightweight Spatial Embedding for Efficient Vision-based 3D Occupancy Prediction","venue":"cs.CV","work_id":"5ab477fc-1221-4667-8538-73b61e743d9a","year":2024},"citing_paper":{"arxiv_id":"2509.08388","last_updated":"2025-09-10T08:29:22Z","snapshot_observed_at":"2026-08-16T10:22:44.957047Z","submitted_at":"2025-09-10T08:29:22Z","title":"Semantic Causality-Aware Vision-Based 3D Occupancy Prediction","version":1},"reference_index":51,"source":"pdf_text","source_observed_at":"2026-08-04T20:49:00.559278Z"},"links":{"cited_paper":"/paper/2412.05976","citing_paper":"/paper/2509.08388"},"observation_digest":"sha256:56cc0e4f95e1843f6818a40772fa8a003c00b3189d0a34d303b16de467ac2bcb","observation_id":"4dae1da8-d7e4-41f8-bd75-43e310339944","resolution":{"observed_at":"2026-08-04T20:49:01.027934Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2304.05316","last_updated":"2023-04-11T16:15:50Z","snapshot_observed_at":"2026-08-16T15:41:14.793093Z","submitted_at":"2023-04-11T16:15:50Z","title":"OccFormer: Dual-path Transformer for Vision-based 3D Semantic Occupancy Prediction","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2304.05316","snapshot_observed_at":"2026-08-04T20:49:00.617025Z","title":"Occformer: Dual-path transformer for vision-based 3d semantic occu- pancy prediction.arXiv preprint arXiv:2304.05316, 2023","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2509.08388","last_updated":"2025-09-10T08:29:22Z","snapshot_observed_at":"2026-08-16T10:22:44.957047Z","submitted_at":"2025-09-10T08:29:22Z","title":"Semantic Causality-Aware Vision-Based 3D Occupancy Prediction","version":1},"reference_index":52,"source":"pdf_text","source_observed_at":"2026-08-04T20:49:00.617025Z"},"links":{"cited_paper":"/paper/2304.05316","citing_paper":"/paper/2509.08388"},"observation_digest":"sha256:10f53da0946a93ca90b4b5ee064d3c4e35455c68b1849c49df12842190514605","observation_id":"16e145b0-7e9c-4bd6-8f66-5c7fe1173288","resolution":{"observed_at":"2026-08-04T20:49:00.617025Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T20:49:02.847701Z","title":"Veon: V ocabulary- enhanced occupancy prediction","venue":null,"work_id":"325ea338-dc29-41d5-937f-302f1e54fa73","year":2024},"citing_paper":{"arxiv_id":"2509.08388","last_updated":"2025-09-10T08:29:22Z","snapshot_observed_at":"2026-08-16T10:22:44.957047Z","submitted_at":"2025-09-10T08:29:22Z","title":"Semantic Causality-Aware Vision-Based 3D Occupancy Prediction","version":1},"reference_index":53,"source":"pdf_text","source_observed_at":"2026-08-04T20:49:00.726687Z"},"links":{"citing_paper":"/paper/2509.08388"},"observation_digest":"sha256:8823e3fa8fcd197b359be173ab0855d27d8b6f3a9efc19a2e1f95a9ad9eeb7f3","observation_id":"54a482bc-88b0-40e5-bf07-408e70b4c5b1","resolution":{"observed_at":"2026-08-04T20:49:02.939771Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T20:49:02.613909Z","title":"Visual in-context learning for large vision-language models","venue":null,"work_id":"fde18169-3203-496b-a39c-ac5ab42f6f83","year":2024},"citing_paper":{"arxiv_id":"2509.08388","last_updated":"2025-09-10T08:29:22Z","snapshot_observed_at":"2026-08-16T10:22:44.957047Z","submitted_at":"2025-09-10T08:29:22Z","title":"Semantic Causality-Aware Vision-Based 3D Occupancy Prediction","version":1},"reference_index":54,"source":"pdf_text","source_observed_at":"2026-08-04T20:49:00.822248Z"},"links":{"citing_paper":"/paper/2509.08388"},"observation_digest":"sha256:db2207511632ebbad6035e10d65f7c27f75f35a16750d22ed7e30faa2ad3844f","observation_id":"20f7a775-39aa-45d6-9fec-9fbaf422651f","resolution":{"observed_at":"2026-08-04T20:49:02.698241Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}}],"paper":{"arxiv_id":"2509.08388","last_updated":"2025-09-10T08:29:22Z","latest_version":1,"primary_category":"cs.CV","snapshot_observed_at":"2026-08-16T10:22:44.957047Z","submitted_at":"2025-09-10T08:29:22Z","title":"Semantic Causality-Aware Vision-Based 3D Occupancy Prediction"},"reference_resolution":{"displayed":54,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":22,"verified_exact":7,"verified_fuzzy":25},"total_outbound_references":54},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"thesis":"As of 17 August 2026, this Paper Citation Record lists 54 of 54 outbound references and 0 inbound Pith citation observations for arXiv:2509.08388."}