{"as_of":"2026-08-16T00:35:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:acf3d9a5c420a31ad9e45f6f2af325490eb7ddb2d370e8bec7a81d2059da17d9","coverage":[{"denominator":89,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":89,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-07T10:44:39.773683Z","state":"measured"},{"denominator":94,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":94,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-15T06:32:42.880941+00:00","state":"measured"},{"denominator":5,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":5,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-15T18:19:43.669437Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"arxiv_reference","source_observed_at":"2026-06-29T13:33:27.972020Z","state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2506.04623","last_updated":"2025-06-05T04:31:55Z","snapshot_observed_at":"2026-08-15T12:36:15.010641Z","submitted_at":"2025-06-05T04:31:55Z","title":"VoxDet: Rethinking 3D Semantic Occupancy Prediction as Dense Object Detection","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2506.04623","snapshot_observed_at":"2026-08-12T13:40:32.957904Z","title":"V oxdet: Rethink- ing 3d semantic occupancy prediction as dense object detec- tion","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2411.16072","last_updated":"2025-07-30T10:14:35Z","snapshot_observed_at":"2026-08-15T16:12:10.331652Z","submitted_at":"2024-11-25T03:47:10Z","title":"Language Driven Occupancy Prediction","version":3},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-12T13:40:32.957904Z"},"links":{"cited_paper":"/paper/2506.04623","citing_paper":"/paper/2411.16072"},"observation_digest":"sha256:594c35aed8998dee26f947168badae149060d48774a44c5c4301a017b4bde2d4","observation_id":"5d02a0e0-3bdf-4897-a0d6-5f7cdadd5a17","resolution":{"observed_at":"2026-08-12T13:40:32.957904Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2506.04623","last_updated":"2025-06-05T04:31:55Z","snapshot_observed_at":"2026-08-15T12:36:15.010641Z","submitted_at":"2025-06-05T04:31:55Z","title":"VoxDet: Rethinking 3D Semantic Occupancy Prediction as Dense Object Detection","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2506.04623","snapshot_observed_at":"2026-08-15T18:19:43.669437Z","title":"V oxDet: Re- thinking 3d semantic occupancy prediction as dense object detection","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2507.18331","last_updated":"2025-07-24T11:58:01Z","snapshot_observed_at":"2026-08-15T18:12:17.898520Z","submitted_at":"2025-07-24T11:58:01Z","title":"Boosting Multi-View Indoor 3D Object Detection via Adaptive 3D Volume Construction","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-15T18:19:43.669437Z"},"links":{"cited_paper":"/paper/2506.04623","citing_paper":"/paper/2507.18331"},"observation_digest":"sha256:da2fbfe991ac123eed6d8c039be15f7e3f842996503438b3bcb075ef9443133d","observation_id":"9a41abaf-2be6-423c-b6dd-53d242239b6b","resolution":{"observed_at":"2026-08-15T18:19:43.669437Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2506.04623","last_updated":"2025-06-05T04:31:55Z","snapshot_observed_at":"2026-08-15T12:36:15.010641Z","submitted_at":"2025-06-05T04:31:55Z","title":"VoxDet: Rethinking 3D Semantic Occupancy Prediction as Dense Object Detection","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2506.04623","snapshot_observed_at":"2026-08-06T04:24:23.190818Z","title":"Voxdet: Rethinking 3d semantic occupancy prediction as dense object detection","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2508.03596","last_updated":"2025-08-05T16:01:00Z","snapshot_observed_at":"2026-08-13T05:07:47.405124Z","submitted_at":"2025-08-05T16:01:00Z","title":"MetaScope: Optics-Driven Neural Network for Ultra-Micro Metalens Endoscopy","version":1},"reference_index":55,"source":"arxiv_source","source_observed_at":"2026-08-06T04:24:23.190818Z"},"links":{"cited_paper":"/paper/2506.04623","citing_paper":"/paper/2508.03596"},"observation_digest":"sha256:521c6a3cec69771f936ec992a41df1266ba1cae83b636477d024bdb43ccdd966","observation_id":"b5aa5931-fd8a-4b3a-b488-054f74686891","resolution":{"observed_at":"2026-08-06T04:24:23.190818Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2506.04623","last_updated":"2025-06-05T04:31:55Z","snapshot_observed_at":"2026-08-15T12:36:15.010641Z","submitted_at":"2025-06-05T04:31:55Z","title":"VoxDet: Rethinking 3D Semantic Occupancy Prediction as Dense Object Detection","version":1},"cited_work":{"arxiv_id":"2506.04623","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2506.04623","snapshot_observed_at":"2026-06-29T13:33:27.972020Z","title":"arXiv preprint arXiv:2506.04623 (2025) 1","venue":null,"work_id":"f5c5edcd-3f27-43f0-97cb-aec703fef003","year":2025},"citing_paper":{"arxiv_id":"2605.15424","last_updated":"2026-05-14T21:16:01Z","snapshot_observed_at":"2026-08-15T12:36:39.637395Z","submitted_at":"2026-05-14T21:16:01Z","title":"Social-Mamba: Socially-Aware Trajectory Forecasting with State-Space Models","version":1},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-05-19T15:18:45.615875Z"},"links":{"cited_paper":"/paper/2506.04623","citing_paper":"/paper/2605.15424"},"observation_digest":"sha256:c05b3b5be5e3d28f78eb6c39e0163664cc7fb6c36052f6c317552098fc1b21a0","observation_id":"2784a536-a90b-420e-84b5-6bb658801eb9","resolution":{"observed_at":"2026-05-19T15:22:37.450789Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2506.04623","last_updated":"2025-06-05T04:31:55Z","snapshot_observed_at":"2026-08-15T12:36:15.010641Z","submitted_at":"2025-06-05T04:31:55Z","title":"VoxDet: Rethinking 3D Semantic Occupancy Prediction as Dense Object Detection","version":1},"cited_work":{"arxiv_id":"2506.04623","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2506.04623","snapshot_observed_at":"2026-06-29T13:33:27.972020Z","title":"arXiv preprint arXiv:2506.04623 (2025) 1","venue":null,"work_id":"f5c5edcd-3f27-43f0-97cb-aec703fef003","year":2025},"citing_paper":{"arxiv_id":"2605.28587","last_updated":"2026-05-27T15:09:55Z","snapshot_observed_at":"2026-08-12T19:53:17.138690Z","submitted_at":"2026-05-27T15:09:55Z","title":"Deformable Gaussian Occupancy: Decoupling Rigid and Nonrigid Motion with Factorized Distillation","version":1},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-06-29T13:30:35.054988Z"},"links":{"cited_paper":"/paper/2506.04623","citing_paper":"/paper/2605.28587"},"observation_digest":"sha256:c7600f285492d163ba5dd263ea304d51b15e6d09bc5ddb0f5e8785e03d299ae5","observation_id":"940a0e24-81d7-4fc5-92b5-aca9263ea364","resolution":{"observed_at":"2026-06-29T13:33:27.973623Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}}],"links":{"evidence":"/evidence","html":"/paper/2506.04623/citation-record","integrity":"/paper/2506.04623/integrity","json":"/paper/2506.04623/citation-record.json","paper":"/paper/2506.04623"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T10:44:32.706523Z","title":"Social lstm: Human trajectory prediction in crowded spaces","venue":null,"work_id":null,"year":2016},"citing_paper":{"arxiv_id":"2506.04623","last_updated":"2025-06-05T04:31:55Z","snapshot_observed_at":"2026-08-15T12:36:15.010641Z","submitted_at":"2025-06-05T04:31:55Z","title":"VoxDet: Rethinking 3D Semantic Occupancy Prediction as Dense Object Detection","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-07T10:44:32.706523Z"},"links":{"citing_paper":"/paper/2506.04623"},"observation_digest":"sha256:e20b309149ed53b304f4f1c8bf90b1c9949fd5c577b1af61054e57e9c12f131f","observation_id":"7de0928d-67e1-4a9c-b88d-a6cb4452b422","resolution":{"observed_at":"2026-08-07T10:44:32.706523Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2411.16129","last_updated":"2025-03-26T02:31:32Z","snapshot_observed_at":"2026-08-12T13:29:29.316751Z","submitted_at":"2024-11-25T06:33:43Z","title":"Three Cars Approaching within 100m! Enhancing Distant Geometry by Tri-Axis Voxel Scanning for Camera-based Semantic Scene Completion","version":2},"cited_work":{"arxiv_id":"2411.16129","doi":null,"metadata_source":"pith","pith_arxiv_id":"2411.16129","snapshot_observed_at":"2026-08-07T10:44:40.295477Z","title":"Three Cars Approaching within 100m! Enhancing Distant Geometry by Tri-Axis Voxel Scanning for Camera-based Semantic Scene Completion","venue":"cs.CV","work_id":"fa53d12e-5b77-49f7-a0ca-461bc1a2d7e5","year":2024},"citing_paper":{"arxiv_id":"2506.04623","last_updated":"2025-06-05T04:31:55Z","snapshot_observed_at":"2026-08-15T12:36:15.010641Z","submitted_at":"2025-06-05T04:31:55Z","title":"VoxDet: Rethinking 3D Semantic Occupancy Prediction as Dense Object Detection","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-07T10:44:32.787018Z"},"links":{"cited_paper":"/paper/2411.16129","citing_paper":"/paper/2506.04623"},"observation_digest":"sha256:213fec56d3216b375af83d6ed7eceb558b6958ed08c0bfae37d25dcad94c0256","observation_id":"e87d0bf1-58bb-4969-85cd-3ecaf94929f1","resolution":{"observed_at":"2026-08-07T10:44:40.298728Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T10:44:32.870789Z","title":"Semantickitti: A dataset for semantic scene understanding of lidar sequences","venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2506.04623","last_updated":"2025-06-05T04:31:55Z","snapshot_observed_at":"2026-08-15T12:36:15.010641Z","submitted_at":"2025-06-05T04:31:55Z","title":"VoxDet: Rethinking 3D Semantic Occupancy Prediction as Dense Object Detection","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-07T10:44:32.870789Z"},"links":{"citing_paper":"/paper/2506.04623"},"observation_digest":"sha256:6615c9d2da7febc5cc2c28ab127d9c1ae954a6564d84d0d25820d626319054d6","observation_id":"4def9f36-0e5f-4ffa-9322-127bfd59e1aa","resolution":{"observed_at":"2026-08-07T10:44:32.870789Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T10:44:32.955158Z","title":"Semantickitti: A dataset for semantic scene understanding of lidar sequences","venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2506.04623","last_updated":"2025-06-05T04:31:55Z","snapshot_observed_at":"2026-08-15T12:36:15.010641Z","submitted_at":"2025-06-05T04:31:55Z","title":"VoxDet: Rethinking 3D Semantic Occupancy Prediction as Dense Object Detection","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-07T10:44:32.955158Z"},"links":{"citing_paper":"/paper/2506.04623"},"observation_digest":"sha256:983ec5f063becc779d746c6cfc370cb6b97a6652e38eca6632a500e8b4ddfdf2","observation_id":"faad4b38-5e86-41c6-b1b5-db103f137cbd","resolution":{"observed_at":"2026-08-07T10:44:32.955158Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T10:44:33.060150Z","title":"Adabins: Depth estimation using adaptive bins","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2506.04623","last_updated":"2025-06-05T04:31:55Z","snapshot_observed_at":"2026-08-15T12:36:15.010641Z","submitted_at":"2025-06-05T04:31:55Z","title":"VoxDet: Rethinking 3D Semantic Occupancy Prediction as Dense Object Detection","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-07T10:44:33.060150Z"},"links":{"citing_paper":"/paper/2506.04623"},"observation_digest":"sha256:dba401d3996a2e1b591b3b081b465e39ff7030829014a738b9138977eacf9372","observation_id":"a9dafacf-b749-4b0c-947d-01bbcd77b259","resolution":{"observed_at":"2026-08-07T10:44:33.060150Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T10:44:33.228624Z","title":"Monoscene: Monocular 3d semantic scene completion","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2506.04623","last_updated":"2025-06-05T04:31:55Z","snapshot_observed_at":"2026-08-15T12:36:15.010641Z","submitted_at":"2025-06-05T04:31:55Z","title":"VoxDet: Rethinking 3D Semantic Occupancy Prediction as Dense Object Detection","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-07T10:44:33.228624Z"},"links":{"citing_paper":"/paper/2506.04623"},"observation_digest":"sha256:cc3c0fd0fb9d4e031ac54e595b4044b3d5de11f772aab24fbb7d67311b7863a8","observation_id":"852b602a-9865-41a8-9363-0ac1058dc0e7","resolution":{"observed_at":"2026-08-07T10:44:33.228624Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T10:44:33.365579Z","title":"Pasco: Urban 3d panoptic scene completion with uncertainty awareness","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.04623","last_updated":"2025-06-05T04:31:55Z","snapshot_observed_at":"2026-08-15T12:36:15.010641Z","submitted_at":"2025-06-05T04:31:55Z","title":"VoxDet: Rethinking 3D Semantic Occupancy Prediction as Dense Object Detection","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-07T10:44:33.365579Z"},"links":{"citing_paper":"/paper/2506.04623"},"observation_digest":"sha256:01621878d01dc125314157f82fa4b30cb94cba65c2e0151cde5a3aeb2cd88605","observation_id":"45198415-89a7-4c05-a4ab-cb273612058a","resolution":{"observed_at":"2026-08-07T10:44:33.365579Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T10:44:33.451770Z","title":"End-to-end object detection with transformers","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2506.04623","last_updated":"2025-06-05T04:31:55Z","snapshot_observed_at":"2026-08-15T12:36:15.010641Z","submitted_at":"2025-06-05T04:31:55Z","title":"VoxDet: Rethinking 3D Semantic Occupancy Prediction as Dense Object Detection","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-07T10:44:33.451770Z"},"links":{"citing_paper":"/paper/2506.04623"},"observation_digest":"sha256:6dbd12ffe6a6b1ffbc5a1a8e6e58bb633a96eee750020a2440d5cbf6e9e7aff0","observation_id":"14c6a6d3-b5f1-4e73-b90c-5ad9b7f06d75","resolution":{"observed_at":"2026-08-07T10:44:33.451770Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2502.05040","last_updated":"2025-07-07T15:05:33Z","snapshot_observed_at":"2026-08-12T21:15:17.227249Z","submitted_at":"2025-02-07T16:07:51Z","title":"GaussRender: Learning 3D Occupancy with Gaussian Rendering","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2502.05040","snapshot_observed_at":"2026-08-07T10:44:33.539610Z","title":"Gaussrender: Learning 3d occupancy with gaussian rendering.arXiv preprint arXiv:2502.05040, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2506.04623","last_updated":"2025-06-05T04:31:55Z","snapshot_observed_at":"2026-08-15T12:36:15.010641Z","submitted_at":"2025-06-05T04:31:55Z","title":"VoxDet: Rethinking 3D Semantic Occupancy Prediction as Dense Object Detection","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-07T10:44:33.539610Z"},"links":{"cited_paper":"/paper/2502.05040","citing_paper":"/paper/2506.04623"},"observation_digest":"sha256:a1ab0d55a9ee3a25b38799cbd0176f228c95e5e315dcdc97402baf8608e1def1","observation_id":"be394b1c-2e96-4315-84a1-f9be8de87b95","resolution":{"observed_at":"2026-08-07T10:44:33.539610Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T10:44:33.652764Z","title":"Domain adaptive faster r-cnn for object detection in the wild","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2506.04623","last_updated":"2025-06-05T04:31:55Z","snapshot_observed_at":"2026-08-15T12:36:15.010641Z","submitted_at":"2025-06-05T04:31:55Z","title":"VoxDet: Rethinking 3D Semantic Occupancy Prediction as Dense Object Detection","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-07T10:44:33.652764Z"},"links":{"citing_paper":"/paper/2506.04623"},"observation_digest":"sha256:e374a5cf8aa79ed3032a9c458d9642195952fbe1534d828001d15e451b35de53","observation_id":"96458391-773d-454d-a533-3e2d4f8bf491","resolution":{"observed_at":"2026-08-07T10:44:33.652764Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T10:44:33.764904Z","title":"Disen- tangle your dense object detector","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2506.04623","last_updated":"2025-06-05T04:31:55Z","snapshot_observed_at":"2026-08-15T12:36:15.010641Z","submitted_at":"2025-06-05T04:31:55Z","title":"VoxDet: Rethinking 3D Semantic Occupancy Prediction as Dense Object Detection","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-07T10:44:33.764904Z"},"links":{"citing_paper":"/paper/2506.04623"},"observation_digest":"sha256:de1cae766cc6358b418b9858e5c4baf79008e4ecd7136354b20a6f25cbc13914","observation_id":"7d8f69fe-8394-4b18-888f-caa3d5cfec08","resolution":{"observed_at":"2026-08-07T10:44:33.764904Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T10:44:40.763918Z","title":"3d u-net: learning dense volumetric segmentation from sparse annotation","venue":null,"work_id":"071d30f1-df06-470b-9a98-d3cfd56a89b1","year":2016},"citing_paper":{"arxiv_id":"2506.04623","last_updated":"2025-06-05T04:31:55Z","snapshot_observed_at":"2026-08-15T12:36:15.010641Z","submitted_at":"2025-06-05T04:31:55Z","title":"VoxDet: Rethinking 3D Semantic Occupancy Prediction as Dense Object Detection","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-07T10:44:33.862806Z"},"links":{"citing_paper":"/paper/2506.04623"},"observation_digest":"sha256:833055dda9844fa43d230a017534d0f91ec3be5230940efd28f79f60a3cfe306","observation_id":"1ec2afea-4b64-4ba7-8030-86844f755cf8","resolution":{"observed_at":"2026-08-07T10:44:40.766781Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T10:44:33.951600Z","title":"Deformable convolutional networks","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2506.04623","last_updated":"2025-06-05T04:31:55Z","snapshot_observed_at":"2026-08-15T12:36:15.010641Z","submitted_at":"2025-06-05T04:31:55Z","title":"VoxDet: Rethinking 3D Semantic Occupancy Prediction as Dense Object Detection","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-07T10:44:33.951600Z"},"links":{"citing_paper":"/paper/2506.04623"},"observation_digest":"sha256:040b544dbe2687f944f3dbf54bbb173d259a0b260b119e09743aa6a20d57c238","observation_id":"e640fb16-fff3-4ebb-a661-3d81d05a0ea9","resolution":{"observed_at":"2026-08-07T10:44:33.951600Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T10:44:34.040500Z","title":"Worldscore: A unified evaluation benchmark for world generation.arXiv preprint arXiv:2504.00983, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2506.04623","last_updated":"2025-06-05T04:31:55Z","snapshot_observed_at":"2026-08-15T12:36:15.010641Z","submitted_at":"2025-06-05T04:31:55Z","title":"VoxDet: Rethinking 3D Semantic Occupancy Prediction as Dense Object Detection","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-07T10:44:34.040500Z"},"links":{"citing_paper":"/paper/2506.04623"},"observation_digest":"sha256:6d7ad0b599cec741d671df2c9134091763979d05da9ae9291b4a33c16ff99372","observation_id":"0f5d43b0-20ae-4b48-891a-418ce3f7619a","resolution":{"observed_at":"2026-08-07T10:44:34.040500Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T10:44:40.750577Z","title":"MIT press, 1993","venue":null,"work_id":"bfef3477-03fa-441b-99d6-b6f408b88f0d","year":1993},"citing_paper":{"arxiv_id":"2506.04623","last_updated":"2025-06-05T04:31:55Z","snapshot_observed_at":"2026-08-15T12:36:15.010641Z","submitted_at":"2025-06-05T04:31:55Z","title":"VoxDet: Rethinking 3D Semantic Occupancy Prediction as Dense Object Detection","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-07T10:44:34.132069Z"},"links":{"citing_paper":"/paper/2506.04623"},"observation_digest":"sha256:11c0a0cef61ea45a64e7fd7d3bbe6b88ea3d7e50606ccd9fbbda0dec59b2801f","observation_id":"9121a374-af41-4d2c-a15e-b7048b053227","resolution":{"observed_at":"2026-08-07T10:44:40.753269Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T10:44:40.741131Z","title":"Two stream 3d semantic scene completion","venue":null,"work_id":"c520e371-650b-47af-83e8-41eb584a8ad3","year":2019},"citing_paper":{"arxiv_id":"2506.04623","last_updated":"2025-06-05T04:31:55Z","snapshot_observed_at":"2026-08-15T12:36:15.010641Z","submitted_at":"2025-06-05T04:31:55Z","title":"VoxDet: Rethinking 3D Semantic Occupancy Prediction as Dense Object Detection","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-07T10:44:34.219006Z"},"links":{"citing_paper":"/paper/2506.04623"},"observation_digest":"sha256:943ea783a9693aced7e43c432af64552d31c967fc733717359f20968fb6ca037","observation_id":"c1a075e8-1536-48b1-88ef-146e07941711","resolution":{"observed_at":"2026-08-07T10:44:40.744798Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T10:44:34.298345Z","title":"Are we ready for autonomous driving? the kitti vision benchmark suite","venue":null,"work_id":null,"year":2012},"citing_paper":{"arxiv_id":"2506.04623","last_updated":"2025-06-05T04:31:55Z","snapshot_observed_at":"2026-08-15T12:36:15.010641Z","submitted_at":"2025-06-05T04:31:55Z","title":"VoxDet: Rethinking 3D Semantic Occupancy Prediction as Dense Object Detection","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-07T10:44:34.298345Z"},"links":{"citing_paper":"/paper/2506.04623"},"observation_digest":"sha256:74d0776932362e359d3d51d166d99424e73d659d54e3070599e045aadeaafc5f","observation_id":"7e9ebb3d-fc93-4916-a73e-941292dcafd3","resolution":{"observed_at":"2026-08-07T10:44:34.298345Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T10:44:34.393084Z","title":"Fast r-cnn","venue":null,"work_id":null,"year":2015},"citing_paper":{"arxiv_id":"2506.04623","last_updated":"2025-06-05T04:31:55Z","snapshot_observed_at":"2026-08-15T12:36:15.010641Z","submitted_at":"2025-06-05T04:31:55Z","title":"VoxDet: Rethinking 3D Semantic Occupancy Prediction as Dense Object Detection","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-07T10:44:34.393084Z"},"links":{"citing_paper":"/paper/2506.04623"},"observation_digest":"sha256:2860553922c91ac32ab4605874b968480a0d25b778d21a8815c237b99a4b21cb","observation_id":"1ad22272-4770-42ae-af07-369a120a4efe","resolution":{"observed_at":"2026-08-07T10:44:34.393084Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T10:44:40.721774Z","title":"Sgformer: Satellite-ground fusion for 3d semantic scene completion","venue":null,"work_id":"a77d2a4d-1abb-42c3-a4f7-c08d0af3fb72","year":2025},"citing_paper":{"arxiv_id":"2506.04623","last_updated":"2025-06-05T04:31:55Z","snapshot_observed_at":"2026-08-15T12:36:15.010641Z","submitted_at":"2025-06-05T04:31:55Z","title":"VoxDet: Rethinking 3D Semantic Occupancy Prediction as Dense Object Detection","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-07T10:44:34.492587Z"},"links":{"citing_paper":"/paper/2506.04623"},"observation_digest":"sha256:806a76e20dfa4d701921cd95e0260050d184420fe71f13af3c29fd9426747467","observation_id":"bcb51231-69e7-40f6-865d-776f4ffe4c61","resolution":{"observed_at":"2026-08-07T10:44:40.725218Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T10:44:40.713319Z","title":"Masked autoencoders are scalable vision learners","venue":null,"work_id":"ac0a8752-0e3d-4eff-8e59-1be0d9e313fc","year":2022},"citing_paper":{"arxiv_id":"2506.04623","last_updated":"2025-06-05T04:31:55Z","snapshot_observed_at":"2026-08-15T12:36:15.010641Z","submitted_at":"2025-06-05T04:31:55Z","title":"VoxDet: Rethinking 3D Semantic Occupancy Prediction as Dense Object Detection","version":1},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-07T10:44:34.569667Z"},"links":{"citing_paper":"/paper/2506.04623"},"observation_digest":"sha256:36e29c57af2fcece2f19ad4082714037feb761ec26f3c62776adb20d5f3f1530","observation_id":"2c1fa58b-fb81-47a3-a56a-acadcb8a6237","resolution":{"observed_at":"2026-08-07T10:44:40.716474Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T10:44:40.704050Z","title":"Deep residual learning for image recognition","venue":null,"work_id":"388f6f64-adc3-4320-8fad-e75bedf726ce","year":2016},"citing_paper":{"arxiv_id":"2506.04623","last_updated":"2025-06-05T04:31:55Z","snapshot_observed_at":"2026-08-15T12:36:15.010641Z","submitted_at":"2025-06-05T04:31:55Z","title":"VoxDet: Rethinking 3D Semantic Occupancy Prediction as Dense Object Detection","version":1},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-07T10:44:34.654448Z"},"links":{"citing_paper":"/paper/2506.04623"},"observation_digest":"sha256:72e72689773059b708d0ceabd4b07695fb9a377a239c56390b132d8234694190","observation_id":"37c60be4-db14-47e5-9ba0-9c6f1bff364d","resolution":{"observed_at":"2026-08-07T10:44:40.707505Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T10:44:40.694791Z","title":"Tri-perspective view for vision-based 3d semantic occupancy prediction","venue":null,"work_id":"5177a413-ce81-4ec7-8172-353769786844","year":2023},"citing_paper":{"arxiv_id":"2506.04623","last_updated":"2025-06-05T04:31:55Z","snapshot_observed_at":"2026-08-15T12:36:15.010641Z","submitted_at":"2025-06-05T04:31:55Z","title":"VoxDet: Rethinking 3D Semantic Occupancy Prediction as Dense Object Detection","version":1},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-07T10:44:34.766004Z"},"links":{"citing_paper":"/paper/2506.04623"},"observation_digest":"sha256:04790bca4e57c90d74820b162b4b83feb0a846e958bf8b49210a86fb7e36f354","observation_id":"a822c3ee-55eb-4a46-ba5b-3c622c782e61","resolution":{"observed_at":"2026-08-07T10:44:40.698722Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T10:44:40.686030Z","title":"Symphonize 3d semantic scene completion with contextual instance queries.Proceedings of the IEEE/CVF Conference on Computer Vision and Pattern Recognition, 2024","venue":null,"work_id":"0de687af-cf49-443e-a03b-7bc1b464e71a","year":2024},"citing_paper":{"arxiv_id":"2506.04623","last_updated":"2025-06-05T04:31:55Z","snapshot_observed_at":"2026-08-15T12:36:15.010641Z","submitted_at":"2025-06-05T04:31:55Z","title":"VoxDet: Rethinking 3D Semantic Occupancy Prediction as Dense Object Detection","version":1},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-07T10:44:34.842585Z"},"links":{"citing_paper":"/paper/2506.04623"},"observation_digest":"sha256:e517e41926e8c4413719e87a2089982abc0dd99d5a5105744f61e4e41e6ec374","observation_id":"6df1b956-179c-4f47-bdee-4f0c73a70d3a","resolution":{"observed_at":"2026-08-07T10:44:40.689089Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T10:44:34.953253Z","title":"Cornernet: Detecting objects as paired keypoints","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2506.04623","last_updated":"2025-06-05T04:31:55Z","snapshot_observed_at":"2026-08-15T12:36:15.010641Z","submitted_at":"2025-06-05T04:31:55Z","title":"VoxDet: Rethinking 3D Semantic Occupancy Prediction as Dense Object Detection","version":1},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-07T10:44:34.953253Z"},"links":{"citing_paper":"/paper/2506.04623"},"observation_digest":"sha256:0cdb56acb83a6db5b802d393baf7b4b86832ca4f48f6160415c2fba467597766","observation_id":"9655e51a-82ab-4a6d-969b-49bf2209418c","resolution":{"observed_at":"2026-08-07T10:44:34.953253Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T10:44:40.672141Z","title":"Hierarchical temporal context learning for camera-based semantic scene completion","venue":null,"work_id":"b42cbe94-c25a-42bf-9664-c24675da247f","year":2024},"citing_paper":{"arxiv_id":"2506.04623","last_updated":"2025-06-05T04:31:55Z","snapshot_observed_at":"2026-08-15T12:36:15.010641Z","submitted_at":"2025-06-05T04:31:55Z","title":"VoxDet: Rethinking 3D Semantic Occupancy Prediction as Dense Object Detection","version":1},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-08-07T10:44:35.041907Z"},"links":{"citing_paper":"/paper/2506.04623"},"observation_digest":"sha256:247e064a9a468b646a825edc6032014c4e2d38bbcf6dd0459520ce34d8728017","observation_id":"d74ac408-00a6-4468-a8d9-acf7abd5b406","resolution":{"observed_at":"2026-08-07T10:44:40.675959Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2303.13959","last_updated":"2024-05-06T15:14:22Z","snapshot_observed_at":"2026-08-13T12:17:45.687104Z","submitted_at":"2023-03-24T12:33:44Z","title":"Bridging Stereo Geometry and BEV Representation with Reliable Mutual Interaction for Semantic Scene Completion","version":6},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2303.13959","snapshot_observed_at":"2026-08-07T10:44:35.121047Z","title":"Stereoscene: Bev-assisted stereo matching empowers 3d semantic scene completion.arXiv preprint arXiv:2303.13959, 2023","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.04623","last_updated":"2025-06-05T04:31:55Z","snapshot_observed_at":"2026-08-15T12:36:15.010641Z","submitted_at":"2025-06-05T04:31:55Z","title":"VoxDet: Rethinking 3D Semantic Occupancy Prediction as Dense Object Detection","version":1},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-08-07T10:44:35.121047Z"},"links":{"cited_paper":"/paper/2303.13959","citing_paper":"/paper/2506.04623"},"observation_digest":"sha256:5b38e9f4609287529962b8193effc83686b0b3fc4ad5cda2b66f0a1e13fa623b","observation_id":"611b32f4-2d5c-48fa-a93f-055cef8bd1cb","resolution":{"observed_at":"2026-08-07T10:44:35.121047Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T10:44:40.663869Z","title":"Instantsplamp: Fast and generalizable stenography framework for generative gaussian splatting","venue":null,"work_id":"3884c5e4-1fe9-45ff-b043-a22d18d4fc33","year":2025},"citing_paper":{"arxiv_id":"2506.04623","last_updated":"2025-06-05T04:31:55Z","snapshot_observed_at":"2026-08-15T12:36:15.010641Z","submitted_at":"2025-06-05T04:31:55Z","title":"VoxDet: Rethinking 3D Semantic Occupancy Prediction as Dense Object Detection","version":1},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-08-07T10:44:35.196278Z"},"links":{"citing_paper":"/paper/2506.04623"},"observation_digest":"sha256:f663c2ac3d81e9089571121a4ed947561ab00ef456223f4aa0c8ccf670b1cd3e","observation_id":"8c1e29f8-ffa6-4930-ac55-936674326af9","resolution":{"observed_at":"2026-08-07T10:44:40.666928Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T10:44:35.283251Z","title":"U-kan makes strong backbone for medical image segmentation and generation","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2506.04623","last_updated":"2025-06-05T04:31:55Z","snapshot_observed_at":"2026-08-15T12:36:15.010641Z","submitted_at":"2025-06-05T04:31:55Z","title":"VoxDet: Rethinking 3D Semantic Occupancy Prediction as Dense Object Detection","version":1},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-08-07T10:44:35.283251Z"},"links":{"citing_paper":"/paper/2506.04623"},"observation_digest":"sha256:e9a628a490b916971d76890afb4a768c98903fac030910011a6472c310bc4dfe","observation_id":"46fb80b0-f3ca-4830-80a2-aec72e843995","resolution":{"observed_at":"2026-08-07T10:44:35.283251Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2408.09859","last_updated":"2025-03-11T02:14:51Z","snapshot_observed_at":"2026-08-12T23:01:34.467261Z","submitted_at":"2024-08-19T10:07:00Z","title":"OccMamba: Semantic Occupancy Prediction with State Space Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2408.09859","snapshot_observed_at":"2026-08-07T10:44:35.362608Z","title":"Occmamba: Semantic occupancy prediction with state space models.arXiv preprint arXiv:2408.09859, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.04623","last_updated":"2025-06-05T04:31:55Z","snapshot_observed_at":"2026-08-15T12:36:15.010641Z","submitted_at":"2025-06-05T04:31:55Z","title":"VoxDet: Rethinking 3D Semantic Occupancy Prediction as Dense Object Detection","version":1},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-08-07T10:44:35.362608Z"},"links":{"cited_paper":"/paper/2408.09859","citing_paper":"/paper/2506.04623"},"observation_digest":"sha256:804da73c57e49029f0b880e18af0043adf2b321ee48597ae434e410b12e62bfd","observation_id":"51dec6ca-4f57-46bf-817d-776f85cc3f74","resolution":{"observed_at":"2026-08-07T10:44:35.362608Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T10:44:40.651199Z","title":"Htd: Heterogeneous task decoupling for two-stage object detection.IEEE Transactions on Image Processing, 30:9456–9469, 2021","venue":null,"work_id":"c2f7d86b-4c2c-4e7f-828f-94e30240288b","year":2021},"citing_paper":{"arxiv_id":"2506.04623","last_updated":"2025-06-05T04:31:55Z","snapshot_observed_at":"2026-08-15T12:36:15.010641Z","submitted_at":"2025-06-05T04:31:55Z","title":"VoxDet: Rethinking 3D Semantic Occupancy Prediction as Dense Object Detection","version":1},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-08-07T10:44:35.473821Z"},"links":{"citing_paper":"/paper/2506.04623"},"observation_digest":"sha256:327a64f5e33117f8a06b15b6ffa24c1da73baeffd9624c57b352bff8ef96e156","observation_id":"112ba65a-ca27-432b-90e8-f3edcf565a1c","resolution":{"observed_at":"2026-08-07T10:44:40.654254Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T10:44:40.643618Z","title":"Scan: Cross domain object detection with semantic conditioned adaptation","venue":null,"work_id":"37e536f3-766f-421f-9c6b-6a5abd52ea3f","year":2022},"citing_paper":{"arxiv_id":"2506.04623","last_updated":"2025-06-05T04:31:55Z","snapshot_observed_at":"2026-08-15T12:36:15.010641Z","submitted_at":"2025-06-05T04:31:55Z","title":"VoxDet: Rethinking 3D Semantic Occupancy Prediction as Dense Object Detection","version":1},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-08-07T10:44:35.559057Z"},"links":{"citing_paper":"/paper/2506.04623"},"observation_digest":"sha256:c93b70c2887bb11e1b5033d51934ac83639270b9c0ecd1ccdcea31bd9cd8d7e1","observation_id":"5d3f6767-04fa-4d36-8457-8a0e746968df","resolution":{"observed_at":"2026-08-07T10:44:40.646510Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T10:44:40.636004Z","title":"Sigma: Semantic-complete graph matching for domain adaptive object detection","venue":null,"work_id":"d1656368-25d6-43dd-b56b-5a77ed9f6f2f","year":2022},"citing_paper":{"arxiv_id":"2506.04623","last_updated":"2025-06-05T04:31:55Z","snapshot_observed_at":"2026-08-15T12:36:15.010641Z","submitted_at":"2025-06-05T04:31:55Z","title":"VoxDet: Rethinking 3D Semantic Occupancy Prediction as Dense Object Detection","version":1},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-08-07T10:44:35.658794Z"},"links":{"citing_paper":"/paper/2506.04623"},"observation_digest":"sha256:ce7603eaa19dd921ad7c4b8d115dfc609a8a78090a9cd2fd8bca93f02ab72721","observation_id":"3aade382-6f84-4065-9781-1d189f443762","resolution":{"observed_at":"2026-08-07T10:44:40.638835Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T10:44:40.627101Z","title":"Unifying voxel- based representation with transformer for 3d object detection.Advances in Neural Information Processing Systems, 35:18442–18455, 2022","venue":null,"work_id":"99ff272c-7dd3-4df7-89f9-462dbf0ba313","year":2022},"citing_paper":{"arxiv_id":"2506.04623","last_updated":"2025-06-05T04:31:55Z","snapshot_observed_at":"2026-08-15T12:36:15.010641Z","submitted_at":"2025-06-05T04:31:55Z","title":"VoxDet: Rethinking 3D Semantic Occupancy Prediction as Dense Object Detection","version":1},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-08-07T10:44:35.732888Z"},"links":{"citing_paper":"/paper/2506.04623"},"observation_digest":"sha256:24720c638a7634835286f626fb6d21a9c463f94ef9eba061905cf53373bf0b44","observation_id":"6706dda3-2fc0-444e-b1b4-1422c5b2b7d6","resolution":{"observed_at":"2026-08-07T10:44:40.630723Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T10:44:40.618770Z","title":"Sscbench: A large-scale 3d semantic scene completion benchmark for autonomous driving, 2024","venue":null,"work_id":"c1216e39-0d65-4b7c-99da-73c922cca832","year":2024},"citing_paper":{"arxiv_id":"2506.04623","last_updated":"2025-06-05T04:31:55Z","snapshot_observed_at":"2026-08-15T12:36:15.010641Z","submitted_at":"2025-06-05T04:31:55Z","title":"VoxDet: Rethinking 3D Semantic Occupancy Prediction as Dense Object Detection","version":1},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-08-07T10:44:35.844717Z"},"links":{"citing_paper":"/paper/2506.04623"},"observation_digest":"sha256:b00ba90b16baa42385e0aafef7cb4beabd85ccce816d157f9956c18ba03f75ba","observation_id":"08434535-a2dd-4909-a154-ce4477481271","resolution":{"observed_at":"2026-08-07T10:44:40.621756Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T10:44:40.610481Z","title":"Choy, Chaowei Xiao, José M","venue":null,"work_id":"094632d6-2b28-43df-a3da-e7e82a013b12","year":2023},"citing_paper":{"arxiv_id":"2506.04623","last_updated":"2025-06-05T04:31:55Z","snapshot_observed_at":"2026-08-15T12:36:15.010641Z","submitted_at":"2025-06-05T04:31:55Z","title":"VoxDet: Rethinking 3D Semantic Occupancy Prediction as Dense Object Detection","version":1},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-08-07T10:44:35.937734Z"},"links":{"citing_paper":"/paper/2506.04623"},"observation_digest":"sha256:cac5e43a3913a6d87a1078639ca1a65861d584745357d922b2f608b4b678f2a1","observation_id":"84e89480-03ae-4e65-81f9-18e664c89438","resolution":{"observed_at":"2026-08-07T10:44:40.613197Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2501.07260","last_updated":"2025-01-13T12:18:58Z","snapshot_observed_at":"2026-08-10T20:43:58.607520Z","submitted_at":"2025-01-13T12:18:58Z","title":"Skip Mamba Diffusion for Monocular 3D Semantic Scene Completion","version":1},"cited_work":{"arxiv_id":"2501.07260","doi":null,"metadata_source":"pith","pith_arxiv_id":"2501.07260","snapshot_observed_at":"2026-08-07T10:44:40.197056Z","title":"Skip Mamba Diffusion for Monocular 3D Semantic Scene Completion","venue":"cs.CV","work_id":"b78cc599-c80c-4992-9fdf-7bd2e3787814","year":2025},"citing_paper":{"arxiv_id":"2506.04623","last_updated":"2025-06-05T04:31:55Z","snapshot_observed_at":"2026-08-15T12:36:15.010641Z","submitted_at":"2025-06-05T04:31:55Z","title":"VoxDet: Rethinking 3D Semantic Occupancy Prediction as Dense Object Detection","version":1},"reference_index":36,"source":"pdf_text","source_observed_at":"2026-08-07T10:44:36.049098Z"},"links":{"cited_paper":"/paper/2501.07260","citing_paper":"/paper/2506.04623"},"observation_digest":"sha256:833a772294deea01fd7eb4f19b99530a4b6ed77e7a11f137e970eac864fb0721","observation_id":"b090fac3-d936-4e84-9df2-06f50138bc7d","resolution":{"observed_at":"2026-08-07T10:44:40.200213Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T10:44:40.602366Z","title":"Kitti-360: A novel dataset and benchmarks for urban scene understanding in 2d and 3d.IEEE Transactions on Pattern Analysis and Machine Intelligence, pages 3292–3310, 2022","venue":null,"work_id":"3cc923bb-70f1-4cc1-8479-a7afc08268fc","year":2022},"citing_paper":{"arxiv_id":"2506.04623","last_updated":"2025-06-05T04:31:55Z","snapshot_observed_at":"2026-08-15T12:36:15.010641Z","submitted_at":"2025-06-05T04:31:55Z","title":"VoxDet: Rethinking 3D Semantic Occupancy Prediction as Dense Object Detection","version":1},"reference_index":37,"source":"pdf_text","source_observed_at":"2026-08-07T10:44:36.124112Z"},"links":{"citing_paper":"/paper/2506.04623"},"observation_digest":"sha256:49aa16a6fb5d92880f927212294e333ed6c089d9105d41c40627ac40b1911c6e","observation_id":"5f79c07f-652e-46bf-8c5c-85dbf45a4c16","resolution":{"observed_at":"2026-08-07T10:44:40.605438Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T10:44:40.592811Z","title":"Kitti-360: A novel dataset and benchmarks for urban scene understanding in 2d and 3d.IEEE Transactions on Pattern Analysis and Machine Intelligence, 45(3):3292–3310, 2022","venue":null,"work_id":"e09e0d83-2bf4-44a9-b518-2cdb4d9ed133","year":2022},"citing_paper":{"arxiv_id":"2506.04623","last_updated":"2025-06-05T04:31:55Z","snapshot_observed_at":"2026-08-15T12:36:15.010641Z","submitted_at":"2025-06-05T04:31:55Z","title":"VoxDet: Rethinking 3D Semantic Occupancy Prediction as Dense Object Detection","version":1},"reference_index":38,"source":"pdf_text","source_observed_at":"2026-08-07T10:44:36.231677Z"},"links":{"citing_paper":"/paper/2506.04623"},"observation_digest":"sha256:b7aa403d7cefb30e200b61a7603e0d7c0ec8e26bfe6549e671420131624b5baa","observation_id":"4bf206eb-5c83-4db1-87e4-20660ab71fa9","resolution":{"observed_at":"2026-08-07T10:44:40.597135Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T10:44:40.583056Z","title":"Feature pyramid networks for object detection","venue":null,"work_id":"7cb15c9e-a52b-460a-8336-0f4ed894c181","year":2017},"citing_paper":{"arxiv_id":"2506.04623","last_updated":"2025-06-05T04:31:55Z","snapshot_observed_at":"2026-08-15T12:36:15.010641Z","submitted_at":"2025-06-05T04:31:55Z","title":"VoxDet: Rethinking 3D Semantic Occupancy Prediction as Dense Object Detection","version":1},"reference_index":39,"source":"pdf_text","source_observed_at":"2026-08-07T10:44:36.309263Z"},"links":{"citing_paper":"/paper/2506.04623"},"observation_digest":"sha256:0f35bd47f79d25680f7440d3de0052641669f7482c195e765ad00531e874dcdb","observation_id":"5f802b2e-e492-42bc-bbe0-00fb61a18765","resolution":{"observed_at":"2026-08-07T10:44:40.586981Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T10:44:40.574524Z","title":"Focal loss for dense object detection","venue":null,"work_id":"ad900315-91a8-4a4e-8b6c-b78c457aacf9","year":2017},"citing_paper":{"arxiv_id":"2506.04623","last_updated":"2025-06-05T04:31:55Z","snapshot_observed_at":"2026-08-15T12:36:15.010641Z","submitted_at":"2025-06-05T04:31:55Z","title":"VoxDet: Rethinking 3D Semantic Occupancy Prediction as Dense Object Detection","version":1},"reference_index":40,"source":"pdf_text","source_observed_at":"2026-08-07T10:44:36.397447Z"},"links":{"citing_paper":"/paper/2506.04623"},"observation_digest":"sha256:7591e8e872bc04f3a03428cc763235fc73178dc3d865136cdc68f15744c298f4","observation_id":"8475264d-cfe3-4dc3-a681-3e61b603b970","resolution":{"observed_at":"2026-08-07T10:44:40.577660Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T10:44:40.566361Z","title":"Lgs: A light-weight 4d gaussian splatting for efficient surgical scene reconstruction","venue":null,"work_id":"7a2d9e00-4f98-4e8d-b561-5c0424b01514","year":2024},"citing_paper":{"arxiv_id":"2506.04623","last_updated":"2025-06-05T04:31:55Z","snapshot_observed_at":"2026-08-15T12:36:15.010641Z","submitted_at":"2025-06-05T04:31:55Z","title":"VoxDet: Rethinking 3D Semantic Occupancy Prediction as Dense Object Detection","version":1},"reference_index":41,"source":"pdf_text","source_observed_at":"2026-08-07T10:44:36.513903Z"},"links":{"citing_paper":"/paper/2506.04623"},"observation_digest":"sha256:cd283acdcd37e5248b3453f563a783521efedf4d7ded8ea5e176be5aaa172595","observation_id":"673ebd08-149d-4e70-b6b4-73bc789f4c49","resolution":{"observed_at":"2026-08-07T10:44:40.569389Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2505.15235","last_updated":"2025-05-26T14:57:30Z","snapshot_observed_at":"2026-08-15T12:35:33.585487Z","submitted_at":"2025-05-21T08:14:10Z","title":"X-GRM: Large Gaussian Reconstruction Model for Sparse-view X-rays to Computed Tomography","version":2},"cited_work":{"arxiv_id":"2505.15235","doi":null,"metadata_source":"pith","pith_arxiv_id":"2505.15235","snapshot_observed_at":"2026-08-07T10:44:40.186714Z","title":"X-GRM: Large Gaussian Reconstruction Model for Sparse-view X-rays to Computed Tomography","venue":"eess.IV","work_id":"e512c3ac-f5bc-4bf9-b623-579ac308fbfd","year":2025},"citing_paper":{"arxiv_id":"2506.04623","last_updated":"2025-06-05T04:31:55Z","snapshot_observed_at":"2026-08-15T12:36:15.010641Z","submitted_at":"2025-06-05T04:31:55Z","title":"VoxDet: Rethinking 3D Semantic Occupancy Prediction as Dense Object Detection","version":1},"reference_index":42,"source":"pdf_text","source_observed_at":"2026-08-07T10:44:36.604382Z"},"links":{"cited_paper":"/paper/2505.15235","citing_paper":"/paper/2506.04623"},"observation_digest":"sha256:7cbf3c0d31fd0ae4acf3b8788527210a0fbd268475570c5533e43f23c3f0d5cd","observation_id":"a45d367c-d8bc-4149-be3a-e27d0dcc8cb7","resolution":{"observed_at":"2026-08-07T10:44:40.189783Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1711.05101","last_updated":"2019-01-04T21:01:49Z","snapshot_observed_at":"2026-08-14T20:13:52.872565Z","submitted_at":"2017-11-14T14:24:06Z","title":"Decoupled Weight Decay Regularization","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1711.05101","snapshot_observed_at":"2026-08-07T10:44:36.675644Z","title":"Decoupled weight decay regularization.arXiv preprint arXiv:1711.05101, 2017","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2506.04623","last_updated":"2025-06-05T04:31:55Z","snapshot_observed_at":"2026-08-15T12:36:15.010641Z","submitted_at":"2025-06-05T04:31:55Z","title":"VoxDet: Rethinking 3D Semantic Occupancy Prediction as Dense Object Detection","version":1},"reference_index":43,"source":"pdf_text","source_observed_at":"2026-08-07T10:44:36.675644Z"},"links":{"cited_paper":"/paper/1711.05101","citing_paper":"/paper/2506.04623"},"observation_digest":"sha256:0b2147dfbfcae922224ff2680b8f59e1a52b774ef753363416f159b858d3b918","observation_id":"dc732074-fa27-474c-a6fd-ef8412295c50","resolution":{"observed_at":"2026-08-07T10:44:36.675644Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2304.08069","last_updated":"2024-04-03T11:46:48Z","snapshot_observed_at":"2026-08-15T08:12:04.729897Z","submitted_at":"2023-04-17T08:30:02Z","title":"DETRs Beat YOLOs on Real-time Object Detection","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2304.08069","snapshot_observed_at":"2026-08-07T10:44:36.755868Z","title":"Detrs beat yolos on real-time object detection.arXiv preprint arXiv:2304.08069, 2023","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.04623","last_updated":"2025-06-05T04:31:55Z","snapshot_observed_at":"2026-08-15T12:36:15.010641Z","submitted_at":"2025-06-05T04:31:55Z","title":"VoxDet: Rethinking 3D Semantic Occupancy Prediction as Dense Object Detection","version":1},"reference_index":44,"source":"pdf_text","source_observed_at":"2026-08-07T10:44:36.755868Z"},"links":{"cited_paper":"/paper/2304.08069","citing_paper":"/paper/2506.04623"},"observation_digest":"sha256:8c36a488844a06624074ed394cc101eb47df67ca4eacbd159a02608b942d0305","observation_id":"9b229385-39a7-42e5-a43a-91c778e18b94","resolution":{"observed_at":"2026-08-07T10:44:36.755868Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2312.05752","last_updated":"2024-09-29T06:43:38Z","snapshot_observed_at":"2026-08-13T05:05:52.597814Z","submitted_at":"2023-12-10T04:17:27Z","title":"Camera-based 3D Semantic Scene Completion with Sparse Guidance Network","version":2},"cited_work":{"arxiv_id":"2312.05752","doi":null,"metadata_source":"pith","pith_arxiv_id":"2312.05752","snapshot_observed_at":"2026-08-07T10:44:40.162888Z","title":"Camera-based 3D Semantic Scene Completion with Sparse Guidance Network","venue":"cs.CV","work_id":"6d4a6404-3135-46ff-9a22-c1e12f1156b9","year":2023},"citing_paper":{"arxiv_id":"2506.04623","last_updated":"2025-06-05T04:31:55Z","snapshot_observed_at":"2026-08-15T12:36:15.010641Z","submitted_at":"2025-06-05T04:31:55Z","title":"VoxDet: Rethinking 3D Semantic Occupancy Prediction as Dense Object Detection","version":1},"reference_index":45,"source":"pdf_text","source_observed_at":"2026-08-07T10:44:36.859304Z"},"links":{"cited_paper":"/paper/2312.05752","citing_paper":"/paper/2506.04623"},"observation_digest":"sha256:af703453bbfadcd898c92f16facc8ce19ea1dd2e2635fcd8c8c786b398512bc1","observation_id":"7444cf5c-d0a2-47e3-bc0c-2a3f94831786","resolution":{"observed_at":"2026-08-07T10:44:40.166112Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2504.04732","last_updated":"2025-04-07T05:08:22Z","snapshot_observed_at":"2026-08-12T21:14:11.592689Z","submitted_at":"2025-04-07T05:08:22Z","title":"Inverse++: Vision-Centric 3D Semantic Occupancy Prediction Assisted with 3D Object Detection","version":1},"cited_work":{"arxiv_id":"2504.04732","doi":null,"metadata_source":"pith","pith_arxiv_id":"2504.04732","snapshot_observed_at":"2026-08-07T10:44:40.151875Z","title":"Inverse++: Vision-Centric 3D Semantic Occupancy Prediction Assisted with 3D Object Detection","venue":"cs.CV","work_id":"67ae2ee9-393f-4a90-aee9-62ea6cce00a8","year":2025},"citing_paper":{"arxiv_id":"2506.04623","last_updated":"2025-06-05T04:31:55Z","snapshot_observed_at":"2026-08-15T12:36:15.010641Z","submitted_at":"2025-06-05T04:31:55Z","title":"VoxDet: Rethinking 3D Semantic Occupancy Prediction as Dense Object Detection","version":1},"reference_index":46,"source":"pdf_text","source_observed_at":"2026-08-07T10:44:36.924654Z"},"links":{"cited_paper":"/paper/2504.04732","citing_paper":"/paper/2506.04623"},"observation_digest":"sha256:e6752580402354f6e3b017009aefb24b3fe4d4dbe1b292a226ca53d607e22700","observation_id":"156f4522-059d-4f54-a091-35545709aa58","resolution":{"observed_at":"2026-08-07T10:44:40.155165Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T10:44:40.557495Z","title":"Lift, splat, shoot: Encoding images from arbitrary camera rigs by implicitly unprojecting to 3d","venue":null,"work_id":"c503ab18-c44d-4f51-b894-14c39418b372","year":2020},"citing_paper":{"arxiv_id":"2506.04623","last_updated":"2025-06-05T04:31:55Z","snapshot_observed_at":"2026-08-15T12:36:15.010641Z","submitted_at":"2025-06-05T04:31:55Z","title":"VoxDet: Rethinking 3D Semantic Occupancy Prediction as Dense Object Detection","version":1},"reference_index":47,"source":"pdf_text","source_observed_at":"2026-08-07T10:44:36.973260Z"},"links":{"citing_paper":"/paper/2506.04623"},"observation_digest":"sha256:89fd411d35f381fe691578444055ecc8cef8f09b6b459a4316c3157d74ebc484","observation_id":"6a6d2e64-2550-43eb-a907-5275fe594b38","resolution":{"observed_at":"2026-08-07T10:44:40.560629Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T10:44:40.548923Z","title":"Borderdet: Border feature for dense object detection","venue":null,"work_id":"db88dcd0-bfae-41c0-ab67-e78e67609c20","year":2020},"citing_paper":{"arxiv_id":"2506.04623","last_updated":"2025-06-05T04:31:55Z","snapshot_observed_at":"2026-08-15T12:36:15.010641Z","submitted_at":"2025-06-05T04:31:55Z","title":"VoxDet: Rethinking 3D Semantic Occupancy Prediction as Dense Object Detection","version":1},"reference_index":48,"source":"pdf_text","source_observed_at":"2026-08-07T10:44:37.043094Z"},"links":{"citing_paper":"/paper/2506.04623"},"observation_digest":"sha256:98b58b05437d94f4db0e9f9483dbff89504d1646d722d712aaf41b9b88c7cad8","observation_id":"dc077b2a-8d62-4287-b92f-bd05650ce6b2","resolution":{"observed_at":"2026-08-07T10:44:40.552039Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T10:44:37.084954Z","title":"Faster r-cnn: Towards real-time object detection with region proposal networks.IEEE transactions on pattern analysis and machine intelligence, 39(6):1137–1149, 2016","venue":null,"work_id":null,"year":2016},"citing_paper":{"arxiv_id":"2506.04623","last_updated":"2025-06-05T04:31:55Z","snapshot_observed_at":"2026-08-15T12:36:15.010641Z","submitted_at":"2025-06-05T04:31:55Z","title":"VoxDet: Rethinking 3D Semantic Occupancy Prediction as Dense Object Detection","version":1},"reference_index":49,"source":"pdf_text","source_observed_at":"2026-08-07T10:44:37.084954Z"},"links":{"citing_paper":"/paper/2506.04623"},"observation_digest":"sha256:0890318b24ad87433db99d199eb9d89a2f16bcec129dd292c1ab4ef87342dd67","observation_id":"28dab664-304a-40ff-bd14-eb1e24eed0e4","resolution":{"observed_at":"2026-08-07T10:44:37.084954Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T10:44:40.536258Z","title":"Semantic scene completion using local deep implicit functions on lidar data.IEEE transactions on pattern analysis and machine intelligence, 44(10):7205–7218, 2021","venue":null,"work_id":"bc562979-e200-4ce4-9bad-b3dde36b613c","year":2021},"citing_paper":{"arxiv_id":"2506.04623","last_updated":"2025-06-05T04:31:55Z","snapshot_observed_at":"2026-08-15T12:36:15.010641Z","submitted_at":"2025-06-05T04:31:55Z","title":"VoxDet: Rethinking 3D Semantic Occupancy Prediction as Dense Object Detection","version":1},"reference_index":50,"source":"pdf_text","source_observed_at":"2026-08-07T10:44:37.147785Z"},"links":{"citing_paper":"/paper/2506.04623"},"observation_digest":"sha256:b9a1f804ea55ea5205f8e1f6ccdaebab2cd23f2bd22c161de734c3e270a75110","observation_id":"93dfe922-c72e-4735-ab70-461760a5f547","resolution":{"observed_at":"2026-08-07T10:44:40.539330Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T10:44:40.527578Z","title":"Lmscnet: Lightweight multiscale 3d semantic completion","venue":null,"work_id":"9b733a2a-96f4-45d2-833d-2917c275367a","year":2020},"citing_paper":{"arxiv_id":"2506.04623","last_updated":"2025-06-05T04:31:55Z","snapshot_observed_at":"2026-08-15T12:36:15.010641Z","submitted_at":"2025-06-05T04:31:55Z","title":"VoxDet: Rethinking 3D Semantic Occupancy Prediction as Dense Object Detection","version":1},"reference_index":51,"source":"pdf_text","source_observed_at":"2026-08-07T10:44:37.224276Z"},"links":{"citing_paper":"/paper/2506.04623"},"observation_digest":"sha256:abb60ef74a65389e1c7b5f4a16fc4c7c3474fe77e67a064ba206425c3867847f","observation_id":"2cf08de4-3025-4d63-a9ab-511ca43a84a9","resolution":{"observed_at":"2026-08-07T10:44:40.530112Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T10:44:40.519537Z","title":"3d semantic scene completion: A survey.International Journal of Computer Vision, 130(8):1978–2005, 2022","venue":null,"work_id":"561b136e-8073-4ce4-a56e-0472db81376f","year":1978},"citing_paper":{"arxiv_id":"2506.04623","last_updated":"2025-06-05T04:31:55Z","snapshot_observed_at":"2026-08-15T12:36:15.010641Z","submitted_at":"2025-06-05T04:31:55Z","title":"VoxDet: Rethinking 3D Semantic Occupancy Prediction as Dense Object Detection","version":1},"reference_index":52,"source":"pdf_text","source_observed_at":"2026-08-07T10:44:37.406058Z"},"links":{"citing_paper":"/paper/2506.04623"},"observation_digest":"sha256:110b6cd4e763bc7ee02c98794a6af42798ec479f79e724819bd4e2ec38045d56","observation_id":"bad88318-d37b-4366-bea3-8891a2a1854f","resolution":{"observed_at":"2026-08-07T10:44:40.522508Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T10:44:40.511234Z","title":"Mobilestereonet: Towards lightweight deep networks for stereo matching","venue":null,"work_id":"27dcc940-fa35-4155-898c-6bed603bd2a3","year":2022},"citing_paper":{"arxiv_id":"2506.04623","last_updated":"2025-06-05T04:31:55Z","snapshot_observed_at":"2026-08-15T12:36:15.010641Z","submitted_at":"2025-06-05T04:31:55Z","title":"VoxDet: Rethinking 3D Semantic Occupancy Prediction as Dense Object Detection","version":1},"reference_index":53,"source":"pdf_text","source_observed_at":"2026-08-07T10:44:37.452780Z"},"links":{"citing_paper":"/paper/2506.04623"},"observation_digest":"sha256:8972597aa41cb4308e4e82b95167bdce5620b67d4a55eca6812060d94f8b28d5","observation_id":"fcf6f17b-78d2-4929-b417-028059891be5","resolution":{"observed_at":"2026-08-07T10:44:40.514194Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T10:44:40.502096Z","title":"Revisiting the sibling head in object detector","venue":null,"work_id":"063192cc-bc3a-4cf1-9910-9dadc3665fc3","year":2020},"citing_paper":{"arxiv_id":"2506.04623","last_updated":"2025-06-05T04:31:55Z","snapshot_observed_at":"2026-08-15T12:36:15.010641Z","submitted_at":"2025-06-05T04:31:55Z","title":"VoxDet: Rethinking 3D Semantic Occupancy Prediction as Dense Object Detection","version":1},"reference_index":54,"source":"pdf_text","source_observed_at":"2026-08-07T10:44:37.523432Z"},"links":{"citing_paper":"/paper/2506.04623"},"observation_digest":"sha256:d3d74ccac4a0a57f9118f0776168fb53d54dcaa19930f7295220fae5a5d80b55","observation_id":"9519cd19-d517-4819-992a-5cbaaa485ff3","resolution":{"observed_at":"2026-08-07T10:44:40.505087Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T10:44:40.493954Z","title":"Chang, Manolis Savva, and Thomas A","venue":null,"work_id":"dc010e42-e0d4-4838-9d7e-cb090bda75c6","year":2017},"citing_paper":{"arxiv_id":"2506.04623","last_updated":"2025-06-05T04:31:55Z","snapshot_observed_at":"2026-08-15T12:36:15.010641Z","submitted_at":"2025-06-05T04:31:55Z","title":"VoxDet: Rethinking 3D Semantic Occupancy Prediction as Dense Object Detection","version":1},"reference_index":55,"source":"pdf_text","source_observed_at":"2026-08-07T10:44:37.559519Z"},"links":{"citing_paper":"/paper/2506.04623"},"observation_digest":"sha256:0512a9018129d6edefd47f406a1033036bd9db347b60f95b7bf121ccf88bf0bf","observation_id":"8407d5b7-31bc-4915-857d-faa7a349269b","resolution":{"observed_at":"2026-08-07T10:44:40.496884Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T10:44:37.626205Z","title":"Fcos: Fully convolutional one-stage object detection","venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2506.04623","last_updated":"2025-06-05T04:31:55Z","snapshot_observed_at":"2026-08-15T12:36:15.010641Z","submitted_at":"2025-06-05T04:31:55Z","title":"VoxDet: Rethinking 3D Semantic Occupancy Prediction as Dense Object Detection","version":1},"reference_index":56,"source":"pdf_text","source_observed_at":"2026-08-07T10:44:37.626205Z"},"links":{"citing_paper":"/paper/2506.04623"},"observation_digest":"sha256:ca3907a7c00787515f5392748da9a2f05958d72a35b7269baef0c68f351fd465","observation_id":"48052458-3c10-46a2-9878-c89c2bb6e4e9","resolution":{"observed_at":"2026-08-07T10:44:37.626205Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T10:44:40.480214Z","title":"V oxel proposal network via multi-frame knowledge distillation for semantic scene completion.Advances in Neural Information Processing Systems, 37:101096–101115, 2024","venue":null,"work_id":"65321d95-5a7e-43c9-a97f-3da41b1fbec6","year":2024},"citing_paper":{"arxiv_id":"2506.04623","last_updated":"2025-06-05T04:31:55Z","snapshot_observed_at":"2026-08-15T12:36:15.010641Z","submitted_at":"2025-06-05T04:31:55Z","title":"VoxDet: Rethinking 3D Semantic Occupancy Prediction as Dense Object Detection","version":1},"reference_index":57,"source":"pdf_text","source_observed_at":"2026-08-07T10:44:37.678995Z"},"links":{"citing_paper":"/paper/2506.04623"},"observation_digest":"sha256:84e7f43194017998d8fe9f2166a9e4213dd0a8e93269d4ba1dfae154a04a782c","observation_id":"4eddb841-f96e-4fca-932a-a26ab6457ca9","resolution":{"observed_at":"2026-08-07T10:44:40.483409Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T10:44:40.470759Z","title":"Vlscene: Vision- language guidance distillation for camera-based 3d semantic scene completion","venue":null,"work_id":"6c4c5799-a44d-462b-8caa-f9236e904be8","year":2025},"citing_paper":{"arxiv_id":"2506.04623","last_updated":"2025-06-05T04:31:55Z","snapshot_observed_at":"2026-08-15T12:36:15.010641Z","submitted_at":"2025-06-05T04:31:55Z","title":"VoxDet: Rethinking 3D Semantic Occupancy Prediction as Dense Object Detection","version":1},"reference_index":58,"source":"pdf_text","source_observed_at":"2026-08-07T10:44:37.718591Z"},"links":{"citing_paper":"/paper/2506.04623"},"observation_digest":"sha256:c23d346d693735ee26b1801dabf0df52830e1deac9f72ce399288d0c0b8e4b8b","observation_id":"eedaf682-0cca-4c37-804a-92ab14f81a05","resolution":{"observed_at":"2026-08-07T10:44:40.474374Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T10:44:40.462977Z","title":"Nas-fcos: Fast neural architecture search for object detection","venue":null,"work_id":"29264e74-5ca7-493c-b531-f98dc1eeffbf","year":2020},"citing_paper":{"arxiv_id":"2506.04623","last_updated":"2025-06-05T04:31:55Z","snapshot_observed_at":"2026-08-15T12:36:15.010641Z","submitted_at":"2025-06-05T04:31:55Z","title":"VoxDet: Rethinking 3D Semantic Occupancy Prediction as Dense Object Detection","version":1},"reference_index":59,"source":"pdf_text","source_observed_at":"2026-08-07T10:44:37.778869Z"},"links":{"citing_paper":"/paper/2506.04623"},"observation_digest":"sha256:e16c8df83b4fa2fa6123f1fa994c1b0e578bc4bcdd09da0a4f92ee04e3f572e5","observation_id":"bcad2f04-85c7-4bec-96a9-9059cc99bfef","resolution":{"observed_at":"2026-08-07T10:44:40.465703Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2503.12369","last_updated":"2025-03-16T06:09:36Z","snapshot_observed_at":"2026-08-07T17:01:04.113266Z","submitted_at":"2025-03-16T06:09:36Z","title":"L2COcc: Lightweight Camera-Centric Semantic Scene Completion via Distillation of LiDAR Model","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2503.12369","snapshot_observed_at":"2026-08-07T10:44:37.840700Z","title":"L2cocc: Lightweight camera-centric semantic scene completion via distillation of lidar model.arXiv preprint arXiv:2503.12369, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2506.04623","last_updated":"2025-06-05T04:31:55Z","snapshot_observed_at":"2026-08-15T12:36:15.010641Z","submitted_at":"2025-06-05T04:31:55Z","title":"VoxDet: Rethinking 3D Semantic Occupancy Prediction as Dense Object Detection","version":1},"reference_index":60,"source":"pdf_text","source_observed_at":"2026-08-07T10:44:37.840700Z"},"links":{"cited_paper":"/paper/2503.12369","citing_paper":"/paper/2506.04623"},"observation_digest":"sha256:79ba09ba80dd9b45b570617435b0b08677f64c19c97a66a97d92532c5ac99bd0","observation_id":"513c7aa8-0582-458e-8990-4b546ca68fbb","resolution":{"observed_at":"2026-08-07T10:44:37.840700Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2404.11958","last_updated":"2024-04-18T07:25:59Z","snapshot_observed_at":"2026-08-14T02:13:49.484362Z","submitted_at":"2024-04-18T07:25:59Z","title":"Not All Voxels Are Equal: Hardness-Aware Semantic Scene Completion with Self-Distillation","version":1},"cited_work":{"arxiv_id":"2404.11958","doi":null,"metadata_source":"pith","pith_arxiv_id":"2404.11958","snapshot_observed_at":"2026-08-07T10:44:40.134168Z","title":"Not All Voxels Are Equal: Hardness-Aware Semantic Scene Completion with Self-Distillation","venue":"cs.CV","work_id":"eb589707-d1c5-427f-b830-82a0ff3eba2c","year":2024},"citing_paper":{"arxiv_id":"2506.04623","last_updated":"2025-06-05T04:31:55Z","snapshot_observed_at":"2026-08-15T12:36:15.010641Z","submitted_at":"2025-06-05T04:31:55Z","title":"VoxDet: Rethinking 3D Semantic Occupancy Prediction as Dense Object Detection","version":1},"reference_index":61,"source":"pdf_text","source_observed_at":"2026-08-07T10:44:37.917989Z"},"links":{"cited_paper":"/paper/2404.11958","citing_paper":"/paper/2506.04623"},"observation_digest":"sha256:77d4087e7a564208895249a029a1de497172d7ef61d762cfbac32a2e19b8a5da","observation_id":"b81efc28-d28c-40e2-9e68-174ee00f5f1f","resolution":{"observed_at":"2026-08-07T10:44:40.138189Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T10:44:40.454676Z","title":"Fcos3d: Fully convolutional one-stage monocular 3d object detection","venue":null,"work_id":"05ddc3d5-4c57-4a66-baa2-1f1321abb860","year":2021},"citing_paper":{"arxiv_id":"2506.04623","last_updated":"2025-06-05T04:31:55Z","snapshot_observed_at":"2026-08-15T12:36:15.010641Z","submitted_at":"2025-06-05T04:31:55Z","title":"VoxDet: Rethinking 3D Semantic Occupancy Prediction as Dense Object Detection","version":1},"reference_index":62,"source":"pdf_text","source_observed_at":"2026-08-07T10:44:37.973226Z"},"links":{"citing_paper":"/paper/2506.04623"},"observation_digest":"sha256:ccdcb66b85bcf98bc414e54b9d1854eb336967f9f4708dbbc8e6e49bfc47465e","observation_id":"84379e89-4513-4720-bb8b-eac96b11c32c","resolution":{"observed_at":"2026-08-07T10:44:40.457633Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T10:44:40.445826Z","title":null,"venue":null,"work_id":"60ed3c54-6a94-47e0-8988-5f6d833150dc","year":2021},"citing_paper":{"arxiv_id":"2506.04623","last_updated":"2025-06-05T04:31:55Z","snapshot_observed_at":"2026-08-15T12:36:15.010641Z","submitted_at":"2025-06-05T04:31:55Z","title":"VoxDet: Rethinking 3D Semantic Occupancy Prediction as Dense Object Detection","version":1},"reference_index":63,"source":"pdf_text","source_observed_at":"2026-08-07T10:44:38.034682Z"},"links":{"citing_paper":"/paper/2506.04623"},"observation_digest":"sha256:15b1776cc8060de7914008adba20b8e4b7a6fd5f9a1361aa7dc39342b89e14cf","observation_id":"cc055b7d-fb0f-4c8a-a515-79e1bd8ce63a","resolution":{"observed_at":"2026-08-07T10:44:40.449555Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T10:44:40.437603Z","title":"H2gformer: Horizontal-to-global voxel transformer for 3d semantic scene completion","venue":null,"work_id":"7fbcc51f-84e3-4674-8a00-2455309a9fcb","year":2024},"citing_paper":{"arxiv_id":"2506.04623","last_updated":"2025-06-05T04:31:55Z","snapshot_observed_at":"2026-08-15T12:36:15.010641Z","submitted_at":"2025-06-05T04:31:55Z","title":"VoxDet: Rethinking 3D Semantic Occupancy Prediction as Dense Object Detection","version":1},"reference_index":64,"source":"pdf_text","source_observed_at":"2026-08-07T10:44:38.084175Z"},"links":{"citing_paper":"/paper/2506.04623"},"observation_digest":"sha256:5f4e62a76a221b01328b7f5d1f80d365f7604c18196bf0859f4e83c67ddc89ef","observation_id":"db222514-f47d-496c-a870-b6a8e7353c46","resolution":{"observed_at":"2026-08-07T10:44:40.440532Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T10:44:38.130572Z","title":"Surroundocc: Multi-camera 3d occupancy prediction for autonomous driving","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.04623","last_updated":"2025-06-05T04:31:55Z","snapshot_observed_at":"2026-08-15T12:36:15.010641Z","submitted_at":"2025-06-05T04:31:55Z","title":"VoxDet: Rethinking 3D Semantic Occupancy Prediction as Dense Object Detection","version":1},"reference_index":65,"source":"pdf_text","source_observed_at":"2026-08-07T10:44:38.130572Z"},"links":{"citing_paper":"/paper/2506.04623"},"observation_digest":"sha256:3083f0cd7d4186b8f8dc0f5b78100a6c50f81b1fb3ea2da3278494d8c01ae711","observation_id":"36046737-46d9-450e-aa7b-31ee156c3503","resolution":{"observed_at":"2026-08-07T10:44:38.130572Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T10:44:40.423839Z","title":"Scpnet: Semantic scene completion on point cloud","venue":null,"work_id":"c0401054-ced9-47c2-9e0b-0e1c41cd006e","year":2023},"citing_paper":{"arxiv_id":"2506.04623","last_updated":"2025-06-05T04:31:55Z","snapshot_observed_at":"2026-08-15T12:36:15.010641Z","submitted_at":"2025-06-05T04:31:55Z","title":"VoxDet: Rethinking 3D Semantic Occupancy Prediction as Dense Object Detection","version":1},"reference_index":66,"source":"pdf_text","source_observed_at":"2026-08-07T10:44:38.211523Z"},"links":{"citing_paper":"/paper/2506.04623"},"observation_digest":"sha256:502bf24990ebc5f27371efce42292cd8ce48e5f6edc9168eea78ecc616024460","observation_id":"6ac74c63-ad23-4ec6-a23f-3a49c4912762","resolution":{"observed_at":"2026-08-07T10:44:40.426788Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T10:44:40.416191Z","title":"Instance-aware monocular 3d semantic scene completion.IEEE Transactions on Intelligent Transportation Systems, 2024","venue":null,"work_id":"a8872b6a-6071-49fb-ab09-932dd09a3eac","year":2024},"citing_paper":{"arxiv_id":"2506.04623","last_updated":"2025-06-05T04:31:55Z","snapshot_observed_at":"2026-08-15T12:36:15.010641Z","submitted_at":"2025-06-05T04:31:55Z","title":"VoxDet: Rethinking 3D Semantic Occupancy Prediction as Dense Object Detection","version":1},"reference_index":67,"source":"pdf_text","source_observed_at":"2026-08-07T10:44:38.268540Z"},"links":{"citing_paper":"/paper/2506.04623"},"observation_digest":"sha256:78ab340203b974cb4ec28f590f2b3e83be76c68206454750a0dbd28eaaefb338","observation_id":"1a0322c9-2679-46b1-b5d7-3981b9e36031","resolution":{"observed_at":"2026-08-07T10:44:40.418991Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T10:44:40.408491Z","title":"Revisiting ap loss for dense object detection: Adaptive ranking pair selection","venue":null,"work_id":"6e61359a-7d1c-4a7a-a36e-62ee0fdeeec6","year":2022},"citing_paper":{"arxiv_id":"2506.04623","last_updated":"2025-06-05T04:31:55Z","snapshot_observed_at":"2026-08-15T12:36:15.010641Z","submitted_at":"2025-06-05T04:31:55Z","title":"VoxDet: Rethinking 3D Semantic Occupancy Prediction as Dense Object Detection","version":1},"reference_index":68,"source":"pdf_text","source_observed_at":"2026-08-07T10:44:38.347973Z"},"links":{"citing_paper":"/paper/2506.04623"},"observation_digest":"sha256:011774dac3a412bf901825bd57522da7654c419d66743fdb365935042e1181b4","observation_id":"86e2847e-9776-40cc-af8c-f3fae97df327","resolution":{"observed_at":"2026-08-07T10:44:40.411449Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T10:44:40.400833Z","title":"Sparse single sweep lidar point cloud segmentation via learning contextual shape priors from scene completion","venue":null,"work_id":"3efa982d-47ba-4a35-8eed-aae0de5a0f04","year":2021},"citing_paper":{"arxiv_id":"2506.04623","last_updated":"2025-06-05T04:31:55Z","snapshot_observed_at":"2026-08-15T12:36:15.010641Z","submitted_at":"2025-06-05T04:31:55Z","title":"VoxDet: Rethinking 3D Semantic Occupancy Prediction as Dense Object Detection","version":1},"reference_index":69,"source":"pdf_text","source_observed_at":"2026-08-07T10:44:38.452237Z"},"links":{"citing_paper":"/paper/2506.04623"},"observation_digest":"sha256:7a98fc2fb5dd6dafe97320fc70bcfe9a559aa958540688c7e6f396341ef1edf4","observation_id":"df7edbe5-68b3-430c-a6b4-2ba9383f6af5","resolution":{"observed_at":"2026-08-07T10:44:40.403850Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2505.13279","last_updated":"2025-05-20T07:45:25Z","snapshot_observed_at":"2026-08-15T20:13:57.857368Z","submitted_at":"2025-05-19T16:02:37Z","title":"Event-Driven Dynamic Scene Depth Completion","version":2},"cited_work":{"arxiv_id":"2505.13279","doi":null,"metadata_source":"pith","pith_arxiv_id":"2505.13279","snapshot_observed_at":"2026-08-07T10:44:40.085859Z","title":"Event-Driven Dynamic Scene Depth Completion","venue":"cs.CV","work_id":"b03cd0cf-d2b1-47a0-81f1-d99f5ef30422","year":2025},"citing_paper":{"arxiv_id":"2506.04623","last_updated":"2025-06-05T04:31:55Z","snapshot_observed_at":"2026-08-15T12:36:15.010641Z","submitted_at":"2025-06-05T04:31:55Z","title":"VoxDet: Rethinking 3D Semantic Occupancy Prediction as Dense Object Detection","version":1},"reference_index":70,"source":"pdf_text","source_observed_at":"2026-08-07T10:44:38.592542Z"},"links":{"cited_paper":"/paper/2505.13279","citing_paper":"/paper/2506.04623"},"observation_digest":"sha256:5928f283e20ee9e36d6d0c0ef5c845859391cd3d27390957ef325e301bd75385","observation_id":"ebc5dfae-3504-4c26-bffc-a370fce97820","resolution":{"observed_at":"2026-08-07T10:44:40.125791Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T10:44:40.391690Z","title":"Rignet++: Semantic assisted repetitive image guided network for depth completion.International Journal of Computer Vision, pages 1–23, 2025","venue":null,"work_id":"b52a0498-5614-42d6-a8ed-01a8461fe62b","year":2025},"citing_paper":{"arxiv_id":"2506.04623","last_updated":"2025-06-05T04:31:55Z","snapshot_observed_at":"2026-08-15T12:36:15.010641Z","submitted_at":"2025-06-05T04:31:55Z","title":"VoxDet: Rethinking 3D Semantic Occupancy Prediction as Dense Object Detection","version":1},"reference_index":71,"source":"pdf_text","source_observed_at":"2026-08-07T10:44:38.697816Z"},"links":{"citing_paper":"/paper/2506.04623"},"observation_digest":"sha256:91a91f880fbc9d884a88b3496bf12878b1e980feac61e9a6e40f065fe514123b","observation_id":"9a9aa3c2-9f15-4043-a69b-aaacc6fd3d11","resolution":{"observed_at":"2026-08-07T10:44:40.395507Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T10:44:40.383104Z","title":"Tri-perspective view decomposition for geometry-aware depth completion","venue":null,"work_id":"28f14627-6000-4442-8fb0-749552798b56","year":2024},"citing_paper":{"arxiv_id":"2506.04623","last_updated":"2025-06-05T04:31:55Z","snapshot_observed_at":"2026-08-15T12:36:15.010641Z","submitted_at":"2025-06-05T04:31:55Z","title":"VoxDet: Rethinking 3D Semantic Occupancy Prediction as Dense Object Detection","version":1},"reference_index":72,"source":"pdf_text","source_observed_at":"2026-08-07T10:44:38.850447Z"},"links":{"citing_paper":"/paper/2506.04623"},"observation_digest":"sha256:ef8496b0e4fb1034046f9283f86adc3a9d82b76df403e4c5041b985fdf759cc8","observation_id":"bff829ab-aaff-440d-a016-a512ce511bd0","resolution":{"observed_at":"2026-08-07T10:44:40.385927Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T10:44:40.374157Z","title":"Rignet: Repetitive image guided network for depth completion","venue":null,"work_id":"d183ded0-58d7-46e2-b21b-e041f4334e0c","year":2022},"citing_paper":{"arxiv_id":"2506.04623","last_updated":"2025-06-05T04:31:55Z","snapshot_observed_at":"2026-08-15T12:36:15.010641Z","submitted_at":"2025-06-05T04:31:55Z","title":"VoxDet: Rethinking 3D Semantic Occupancy Prediction as Dense Object Detection","version":1},"reference_index":73,"source":"pdf_text","source_observed_at":"2026-08-07T10:44:38.969476Z"},"links":{"citing_paper":"/paper/2506.04623"},"observation_digest":"sha256:e227f9fbdd6c7167b327005c02936618377cdd426a0714231b5d67f2b7b309f8","observation_id":"0a5790a4-c555-49cb-9ae5-9786d8ba004f","resolution":{"observed_at":"2026-08-07T10:44:40.377794Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T10:44:40.365888Z","title":"Prediction-guided distillation for dense object detection","venue":null,"work_id":"78dd9d55-bd89-4727-8151-5dc770d43ccf","year":2022},"citing_paper":{"arxiv_id":"2506.04623","last_updated":"2025-06-05T04:31:55Z","snapshot_observed_at":"2026-08-15T12:36:15.010641Z","submitted_at":"2025-06-05T04:31:55Z","title":"VoxDet: Rethinking 3D Semantic Occupancy Prediction as Dense Object Detection","version":1},"reference_index":74,"source":"pdf_text","source_observed_at":"2026-08-07T10:44:39.066137Z"},"links":{"citing_paper":"/paper/2506.04623"},"observation_digest":"sha256:7b69d1c904b1803fbd3d4ece680b84e5191509bd6bc0798f1f096663b7127a55","observation_id":"88ea2d7d-2f66-4b85-851f-828248025b11","resolution":{"observed_at":"2026-08-07T10:44:40.368796Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T10:44:40.358252Z","title":"Semantic segmentation-assisted scene completion for lidar point clouds","venue":null,"work_id":"44ae62dd-d807-4337-bc4d-083d18034bb3","year":2021},"citing_paper":{"arxiv_id":"2506.04623","last_updated":"2025-06-05T04:31:55Z","snapshot_observed_at":"2026-08-15T12:36:15.010641Z","submitted_at":"2025-06-05T04:31:55Z","title":"VoxDet: Rethinking 3D Semantic Occupancy Prediction as Dense Object Detection","version":1},"reference_index":75,"source":"pdf_text","source_observed_at":"2026-08-07T10:44:39.179666Z"},"links":{"citing_paper":"/paper/2506.04623"},"observation_digest":"sha256:6dccc59625c3d8f4b3e554a21d8005652337294b9f7649fac2f3a11f11469f21","observation_id":"1507f06b-024f-4f55-b455-6fb85926061e","resolution":{"observed_at":"2026-08-07T10:44:40.360979Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2501.03605","last_updated":"2025-01-07T08:06:35Z","snapshot_observed_at":"2026-08-10T21:49:07.709615Z","submitted_at":"2025-01-07T08:06:35Z","title":"ConcealGS: Concealing Invisible Copyright Information in 3D Gaussian Splatting","version":1},"cited_work":{"arxiv_id":"2501.03605","doi":null,"metadata_source":"pith","pith_arxiv_id":"2501.03605","snapshot_observed_at":"2026-08-07T10:44:39.944217Z","title":"ConcealGS: Concealing Invisible Copyright Information in 3D Gaussian Splatting","venue":"cs.CV","work_id":"eb6a6958-5c3c-4ca0-b68e-d2666cb2e911","year":2025},"citing_paper":{"arxiv_id":"2506.04623","last_updated":"2025-06-05T04:31:55Z","snapshot_observed_at":"2026-08-15T12:36:15.010641Z","submitted_at":"2025-06-05T04:31:55Z","title":"VoxDet: Rethinking 3D Semantic Occupancy Prediction as Dense Object Detection","version":1},"reference_index":76,"source":"pdf_text","source_observed_at":"2026-08-07T10:44:39.271233Z"},"links":{"cited_paper":"/paper/2501.03605","citing_paper":"/paper/2506.04623"},"observation_digest":"sha256:2c63ab8cf4aba7849b3ff734eee26fe0491907ce2f3c0f06122b316e3aef06e1","observation_id":"11a50356-d025-4490-97df-05a23ac5ba91","resolution":{"observed_at":"2026-08-07T10:44:40.003932Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T10:44:39.273600Z","title":"Daocc: 3d object detection assisted multi-sensor fusion for 3d occupancy prediction.arXiv preprint arXiv:2409.19972, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.04623","last_updated":"2025-06-05T04:31:55Z","snapshot_observed_at":"2026-08-15T12:36:15.010641Z","submitted_at":"2025-06-05T04:31:55Z","title":"VoxDet: Rethinking 3D Semantic Occupancy Prediction as Dense Object Detection","version":1},"reference_index":77,"source":"pdf_text","source_observed_at":"2026-08-07T10:44:39.273600Z"},"links":{"citing_paper":"/paper/2506.04623"},"observation_digest":"sha256:501f6e70c3cfa0624c16da266da912dcb34b8860f9a46e8d15b33b79caf0a531","observation_id":"547970cf-203c-4f96-be8b-1483d56d5089","resolution":{"observed_at":"2026-08-07T10:44:39.273600Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2311.17084","last_updated":"2024-11-25T23:13:35Z","snapshot_observed_at":"2026-08-13T05:15:50.556867Z","submitted_at":"2023-11-28T01:47:51Z","title":"DepthSSC: Monocular 3D Semantic Scene Completion via Depth-Spatial Alignment and Voxel Adaptation","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2311.17084","snapshot_observed_at":"2026-08-07T10:44:39.275821Z","title":"Depthssc: Depth-spatial alignment and dynamic voxel resolution for monocular 3d semantic scene completion.arXiv preprint arXiv:2311.17084, 2023","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.04623","last_updated":"2025-06-05T04:31:55Z","snapshot_observed_at":"2026-08-15T12:36:15.010641Z","submitted_at":"2025-06-05T04:31:55Z","title":"VoxDet: Rethinking 3D Semantic Occupancy Prediction as Dense Object Detection","version":1},"reference_index":78,"source":"pdf_text","source_observed_at":"2026-08-07T10:44:39.275821Z"},"links":{"cited_paper":"/paper/2311.17084","citing_paper":"/paper/2506.04623"},"observation_digest":"sha256:c8d738b01e3260f6bb856737d3c1eec61146ced46a8c561b112ea8f4001059cc","observation_id":"331f99cc-0f19-4fd1-a975-d7979207e480","resolution":{"observed_at":"2026-08-07T10:44:39.275821Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2411.16072","last_updated":"2025-07-30T10:14:35Z","snapshot_observed_at":"2026-08-15T16:12:10.331652Z","submitted_at":"2024-11-25T03:47:10Z","title":"Language Driven Occupancy Prediction","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2411.16072","snapshot_observed_at":"2026-08-07T10:44:39.278703Z","title":"Language driven occupancy prediction","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.04623","last_updated":"2025-06-05T04:31:55Z","snapshot_observed_at":"2026-08-15T12:36:15.010641Z","submitted_at":"2025-06-05T04:31:55Z","title":"VoxDet: Rethinking 3D Semantic Occupancy Prediction as Dense Object Detection","version":1},"reference_index":79,"source":"pdf_text","source_observed_at":"2026-08-07T10:44:39.278703Z"},"links":{"cited_paper":"/paper/2411.16072","citing_paper":"/paper/2506.04623"},"observation_digest":"sha256:0cb68f93350db73786ffe024f468332cc8ea1a6ddb1d0e7d0525998915d0b5ea","observation_id":"60f488f2-6934-4dc1-bcd8-9046e7af7fce","resolution":{"observed_at":"2026-08-07T10:44:39.278703Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T10:44:40.350987Z","title":"Aggregating feature point cloud for depth completion","venue":null,"work_id":"b438a5d7-523e-4621-97a2-5831776b16d9","year":2023},"citing_paper":{"arxiv_id":"2506.04623","last_updated":"2025-06-05T04:31:55Z","snapshot_observed_at":"2026-08-15T12:36:15.010641Z","submitted_at":"2025-06-05T04:31:55Z","title":"VoxDet: Rethinking 3D Semantic Occupancy Prediction as Dense Object Detection","version":1},"reference_index":80,"source":"pdf_text","source_observed_at":"2026-08-07T10:44:39.312771Z"},"links":{"citing_paper":"/paper/2506.04623"},"observation_digest":"sha256:e8f95673bd26ed75ccb71e7b2a129d9cd239d841abc0c9c63ae1a6208a57ab27","observation_id":"34686225-cb38-458e-9939-e52d739b9788","resolution":{"observed_at":"2026-08-07T10:44:40.353683Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T10:44:40.342738Z","title":"Aggregating feature point cloud for depth completion","venue":null,"work_id":"37a24f37-e8e5-48c5-9d71-9de97dee4890","year":2023},"citing_paper":{"arxiv_id":"2506.04623","last_updated":"2025-06-05T04:31:55Z","snapshot_observed_at":"2026-08-15T12:36:15.010641Z","submitted_at":"2025-06-05T04:31:55Z","title":"VoxDet: Rethinking 3D Semantic Occupancy Prediction as Dense Object Detection","version":1},"reference_index":81,"source":"pdf_text","source_observed_at":"2026-08-07T10:44:39.444406Z"},"links":{"citing_paper":"/paper/2506.04623"},"observation_digest":"sha256:90801d48f1a116690e01895aeb30cdadbe09b8f0c9ba05a0c495ad992131375a","observation_id":"3394b1b8-867b-4ff5-b2d8-534963362e87","resolution":{"observed_at":"2026-08-07T10:44:40.345517Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T10:44:40.335055Z","title":"Context and geometry aware voxel transformer for semantic scene completion","venue":null,"work_id":"ef7f0b96-1cbc-4872-90b9-9030c76557fa","year":2024},"citing_paper":{"arxiv_id":"2506.04623","last_updated":"2025-06-05T04:31:55Z","snapshot_observed_at":"2026-08-15T12:36:15.010641Z","submitted_at":"2025-06-05T04:31:55Z","title":"VoxDet: Rethinking 3D Semantic Occupancy Prediction as Dense Object Detection","version":1},"reference_index":82,"source":"pdf_text","source_observed_at":"2026-08-07T10:44:39.545103Z"},"links":{"citing_paper":"/paper/2506.04623"},"observation_digest":"sha256:bcb546ba4e3f40bd54fbb24e11378a83f817eebd0d3eb2f54be5b7692c641804","observation_id":"9394c26a-d4e7-406d-a8f6-cb6c4cc3465f","resolution":{"observed_at":"2026-08-07T10:44:40.338110Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T10:44:39.625757Z","title":"Varifocalnet: An iou-aware dense object detector","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2506.04623","last_updated":"2025-06-05T04:31:55Z","snapshot_observed_at":"2026-08-15T12:36:15.010641Z","submitted_at":"2025-06-05T04:31:55Z","title":"VoxDet: Rethinking 3D Semantic Occupancy Prediction as Dense Object Detection","version":1},"reference_index":83,"source":"pdf_text","source_observed_at":"2026-08-07T10:44:39.625757Z"},"links":{"citing_paper":"/paper/2506.04623"},"observation_digest":"sha256:815d697c2ee5f2759846e8b7a593289d18b88d34fe9b3a3599c528e8b941904b","observation_id":"42540342-14a4-45b5-92f9-df54e2e7ef60","resolution":{"observed_at":"2026-08-07T10:44:39.625757Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T10:44:39.632877Z","title":"Bridging the gap between anchor-based and anchor-free detection via adaptive training sample selection","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2506.04623","last_updated":"2025-06-05T04:31:55Z","snapshot_observed_at":"2026-08-15T12:36:15.010641Z","submitted_at":"2025-06-05T04:31:55Z","title":"VoxDet: Rethinking 3D Semantic Occupancy Prediction as Dense Object Detection","version":1},"reference_index":84,"source":"pdf_text","source_observed_at":"2026-08-07T10:44:39.632877Z"},"links":{"citing_paper":"/paper/2506.04623"},"observation_digest":"sha256:2d5ff2555ba6e7a6e5c68ae4d9b3c65d8c470af4e772830e388366adcebb017f","observation_id":"46399ad2-003e-41d7-bbb3-51f45f850cdf","resolution":{"observed_at":"2026-08-07T10:44:39.632877Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T10:44:40.320028Z","title":null,"venue":null,"work_id":"0585814f-dcbb-4286-a98e-cfad212396c3","year":2023},"citing_paper":{"arxiv_id":"2506.04623","last_updated":"2025-06-05T04:31:55Z","snapshot_observed_at":"2026-08-15T12:36:15.010641Z","submitted_at":"2025-06-05T04:31:55Z","title":"VoxDet: Rethinking 3D Semantic Occupancy Prediction as Dense Object Detection","version":1},"reference_index":85,"source":"pdf_text","source_observed_at":"2026-08-07T10:44:39.635008Z"},"links":{"citing_paper":"/paper/2506.04623"},"observation_digest":"sha256:3d30d28e735b63656b1914af83a4411100cee6a46280b906595ddb2d12f70cd4","observation_id":"b1e1bb9b-6091-49bf-8534-19fd67aa456b","resolution":{"observed_at":"2026-08-07T10:44:40.322754Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2403.08766","last_updated":"2024-03-13T17:59:04Z","snapshot_observed_at":"2026-08-13T00:54:54.548357Z","submitted_at":"2024-03-13T17:59:04Z","title":"MonoOcc: Digging into Monocular Semantic Occupancy Prediction","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2403.08766","snapshot_observed_at":"2026-08-07T10:44:39.637215Z","title":"Monoocc: Digging into monocular semantic occupancy prediction.arXiv preprint arXiv:2403.08766, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.04623","last_updated":"2025-06-05T04:31:55Z","snapshot_observed_at":"2026-08-15T12:36:15.010641Z","submitted_at":"2025-06-05T04:31:55Z","title":"VoxDet: Rethinking 3D Semantic Occupancy Prediction as Dense Object Detection","version":1},"reference_index":86,"source":"pdf_text","source_observed_at":"2026-08-07T10:44:39.637215Z"},"links":{"cited_paper":"/paper/2403.08766","citing_paper":"/paper/2506.04623"},"observation_digest":"sha256:0b3b156fbcbcd50462aeab9329c7ba5fa833cfd0b32390fea08b68689d3b633d","observation_id":"3ae913d7-111b-4c7f-8dd7-cf820e894d64","resolution":{"observed_at":"2026-08-07T10:44:39.637215Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T10:44:40.311835Z","title":"Localization distillation for dense object detection","venue":null,"work_id":"0f005c27-55f0-4244-82b5-e7050be0cc77","year":2022},"citing_paper":{"arxiv_id":"2506.04623","last_updated":"2025-06-05T04:31:55Z","snapshot_observed_at":"2026-08-15T12:36:15.010641Z","submitted_at":"2025-06-05T04:31:55Z","title":"VoxDet: Rethinking 3D Semantic Occupancy Prediction as Dense Object Detection","version":1},"reference_index":87,"source":"pdf_text","source_observed_at":"2026-08-07T10:44:39.639748Z"},"links":{"citing_paper":"/paper/2506.04623"},"observation_digest":"sha256:eaa9011626ae5b56534115ee1c514fcdb561c220cb494cf68f9e622438b18b46","observation_id":"f1834cae-fcf5-4628-b656-78cb0230227c","resolution":{"observed_at":"2026-08-07T10:44:40.315076Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T10:44:40.304327Z","title":"Bottom-up object detection by grouping extreme and center points","venue":null,"work_id":"2d364180-b4f2-44c0-af3b-e645600f3b70","year":2019},"citing_paper":{"arxiv_id":"2506.04623","last_updated":"2025-06-05T04:31:55Z","snapshot_observed_at":"2026-08-15T12:36:15.010641Z","submitted_at":"2025-06-05T04:31:55Z","title":"VoxDet: Rethinking 3D Semantic Occupancy Prediction as Dense Object Detection","version":1},"reference_index":88,"source":"pdf_text","source_observed_at":"2026-08-07T10:44:39.693468Z"},"links":{"citing_paper":"/paper/2506.04623"},"observation_digest":"sha256:2bb66304a4d10c65fa0a5ee5110445e7ba5f99df68ca95c4fa4ab7df6b15141f","observation_id":"cc4a6aab-cc74-49c6-9f3e-6ceefcaf6071","resolution":{"observed_at":"2026-08-07T10:44:40.307096Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2010.04159","last_updated":"2021-03-18T03:14:26Z","snapshot_observed_at":"2026-08-13T17:54:01.724774Z","submitted_at":"2020-10-08T17:59:21Z","title":"Deformable DETR: Deformable Transformers for End-to-End Object Detection","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2010.04159","snapshot_observed_at":"2026-08-07T10:44:39.773683Z","title":"Deformable detr: Deformable transformers for end-to-end object detection.arXiv preprint arXiv:2010.04159, 2020","venue":null,"work_id":null,"year":2010},"citing_paper":{"arxiv_id":"2506.04623","last_updated":"2025-06-05T04:31:55Z","snapshot_observed_at":"2026-08-15T12:36:15.010641Z","submitted_at":"2025-06-05T04:31:55Z","title":"VoxDet: Rethinking 3D Semantic Occupancy Prediction as Dense Object Detection","version":1},"reference_index":89,"source":"pdf_text","source_observed_at":"2026-08-07T10:44:39.773683Z"},"links":{"cited_paper":"/paper/2010.04159","citing_paper":"/paper/2506.04623"},"observation_digest":"sha256:53fc88f5e94d30a21d083c5f760bcceaded6780e69bbd557dafff82b6bef972a","observation_id":"144236fd-f924-4a7b-9450-3b9f513a04be","resolution":{"observed_at":"2026-08-07T10:44:39.773683Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"paper":{"arxiv_id":"2506.04623","last_updated":"2025-06-05T04:31:55Z","latest_version":1,"primary_category":"cs.GR","snapshot_observed_at":"2026-08-15T12:36:15.010641Z","submitted_at":"2025-06-05T04:31:55Z","title":"VoxDet: Rethinking 3D Semantic Occupancy Prediction as Dense Object Detection"},"reference_resolution":{"displayed":89,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":33,"verified_exact":8,"verified_fuzzy":48},"total_outbound_references":89},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"thesis":"As of 16 August 2026, this Paper Citation Record lists 89 of 89 outbound references and 5 inbound Pith citation observations for arXiv:2506.04623."}