{"as_of":"2026-08-19T15:48:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:ebfaed08825b78f6b198b0e6f8781b51c4cda756fc73069b01017d19ff80a5b2","coverage":[{"denominator":54,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":54,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-07T13:11:46.033877Z","state":"measured"},{"denominator":55,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":55,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-19T06:32:44.657259+00:00","state":"measured"},{"denominator":1,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":1,"source":"paper_references, paper_reference_links","source_observed_at":"2026-05-21T11:50:37.423645Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"arxiv_reference","source_observed_at":"2026-05-21T11:54:09.175194Z","state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2505.22461","last_updated":"2025-05-29T14:45:58Z","snapshot_observed_at":"2026-08-18T01:04:18.961194Z","submitted_at":"2025-05-28T15:16:15Z","title":"SHTOcc: Effective 3D Occupancy Prediction with Sparse Head and Tail Voxels","version":2},"cited_work":{"arxiv_id":"2505.22461","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2505.22461","snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Shtocc: Effective 3d occupancy prediction with sparse head and tail voxels","venue":null,"work_id":"d2ef75e1-4341-40db-9b70-ba067464c5da","year":2025},"citing_paper":{"arxiv_id":"2602.22667","last_updated":"2026-05-18T07:52:01Z","snapshot_observed_at":"2026-08-17T01:22:08.210180Z","submitted_at":"2026-02-26T06:37:43Z","title":"Monocular Open Vocabulary Occupancy Prediction for Indoor Scenes","version":2},"reference_index":51,"source":"pdf_text","source_observed_at":"2026-05-21T11:50:37.423645Z"},"links":{"cited_paper":"/paper/2505.22461","citing_paper":"/paper/2602.22667"},"observation_digest":"sha256:c9497503bdfd4f4c5df297600ee30ce856f679235e41baf735f24885d250ab44","observation_id":"aa2cf667-f298-412d-952d-5ee3c7d461c7","resolution":{"observed_at":"2026-05-21T11:54:09.177283Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}}],"links":{"evidence":"/evidence","html":"/paper/2505.22461/citation-record","integrity":"/paper/2505.22461/integrity","json":"/paper/2505.22461/citation-record.json","paper":"/paper/2505.22461"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:11:51.648061Z","title":"Se- mantickitti: A dataset for semantic scene understanding of lidar sequences,","venue":null,"work_id":"609e45f8-8e70-41d8-a2b5-1e658e283176","year":2019},"citing_paper":{"arxiv_id":"2505.22461","last_updated":"2025-05-29T14:45:58Z","snapshot_observed_at":"2026-08-18T01:04:18.961194Z","submitted_at":"2025-05-28T15:16:15Z","title":"SHTOcc: Effective 3D Occupancy Prediction with Sparse Head and Tail Voxels","version":2},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-07T13:11:40.210234Z"},"links":{"citing_paper":"/paper/2505.22461"},"observation_digest":"sha256:5a2f28f47fdf11b43a7ef25844c9623e40fe5c3e1dbacb407832ee4f60d3eb38","observation_id":"21f55780-0720-41b1-a05b-e42efd5e9358","resolution":{"observed_at":"2026-08-07T13:11:51.719720Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:11:40.310333Z","title":"Openoccupancy: A large scale benchmark for surrounding semantic occupancy perception,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.22461","last_updated":"2025-05-29T14:45:58Z","snapshot_observed_at":"2026-08-18T01:04:18.961194Z","submitted_at":"2025-05-28T15:16:15Z","title":"SHTOcc: Effective 3D Occupancy Prediction with Sparse Head and Tail Voxels","version":2},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-07T13:11:40.310333Z"},"links":{"citing_paper":"/paper/2505.22461"},"observation_digest":"sha256:0cc26d0010dc6b5f64f6e18623d060bc08e867340027d5e336b376695c6c9eae","observation_id":"5ff1894f-5bcd-4ecd-bc67-9bd38eb13ebe","resolution":{"observed_at":"2026-08-07T13:11:40.310333Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:11:40.398079Z","title":"nuscenes: A multimodal dataset for autonomous driving,","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2505.22461","last_updated":"2025-05-29T14:45:58Z","snapshot_observed_at":"2026-08-18T01:04:18.961194Z","submitted_at":"2025-05-28T15:16:15Z","title":"SHTOcc: Effective 3D Occupancy Prediction with Sparse Head and Tail Voxels","version":2},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-07T13:11:40.398079Z"},"links":{"citing_paper":"/paper/2505.22461"},"observation_digest":"sha256:9e6539727ec659d389b999d70e171950c1c4687585838261a4c7ee2043801e24","observation_id":"8c388381-f6f8-49b7-a805-074ab874e3d6","resolution":{"observed_at":"2026-08-07T13:11:40.398079Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:11:51.346537Z","title":"Inversematrixvt3d: An efficient projection matrix-based approach for 3d occupancy prediction,","venue":null,"work_id":"4b8a76f6-38e2-4ac4-b377-6a2d1fcd5c80","year":2024},"citing_paper":{"arxiv_id":"2505.22461","last_updated":"2025-05-29T14:45:58Z","snapshot_observed_at":"2026-08-18T01:04:18.961194Z","submitted_at":"2025-05-28T15:16:15Z","title":"SHTOcc: Effective 3D Occupancy Prediction with Sparse Head and Tail Voxels","version":2},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-07T13:11:40.475104Z"},"links":{"citing_paper":"/paper/2505.22461"},"observation_digest":"sha256:5457d321db0fc369079d14689c6ac64a698deeb255d602265c439984f2cad913","observation_id":"1a0ed39b-8aab-40de-8a67-1ed8d24da623","resolution":{"observed_at":"2026-08-07T13:11:51.500728Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:11:51.135007Z","title":"Surroundocc: Multi-camera 3d occupancy prediction for autonomous driving,","venue":null,"work_id":"90c86701-34f0-4728-b49c-f09f7b9a6940","year":2023},"citing_paper":{"arxiv_id":"2505.22461","last_updated":"2025-05-29T14:45:58Z","snapshot_observed_at":"2026-08-18T01:04:18.961194Z","submitted_at":"2025-05-28T15:16:15Z","title":"SHTOcc: Effective 3D Occupancy Prediction with Sparse Head and Tail Voxels","version":2},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-07T13:11:40.570335Z"},"links":{"citing_paper":"/paper/2505.22461"},"observation_digest":"sha256:0fa9daf1b026969457ca370a907ef529812f4b0336a546d64f925b7536b86f63","observation_id":"75accbdf-9a16-4c3c-b3f3-16bd332d22e7","resolution":{"observed_at":"2026-08-07T13:11:51.206215Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:11:40.734800Z","title":"Occformer: Dual-path transformer for vision-based 3d semantic occupancy prediction,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.22461","last_updated":"2025-05-29T14:45:58Z","snapshot_observed_at":"2026-08-18T01:04:18.961194Z","submitted_at":"2025-05-28T15:16:15Z","title":"SHTOcc: Effective 3D Occupancy Prediction with Sparse Head and Tail Voxels","version":2},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-07T13:11:40.734800Z"},"links":{"citing_paper":"/paper/2505.22461"},"observation_digest":"sha256:f13b41e4a31b87b4110ce09ebea46fd5fb89a6df5b3ceed085609e2a7ef414d7","observation_id":"ecf45bff-2b6d-409a-9bf0-e06003d92b79","resolution":{"observed_at":"2026-08-07T13:11:40.734800Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:11:50.921553Z","title":"Fastocc: Accelerating 3d occupancy prediction by fusing the 2d bird’s-eye view and perspective view,","venue":null,"work_id":"8ded0d7c-3a5f-4d89-9e22-b51bfe4da364","year":2024},"citing_paper":{"arxiv_id":"2505.22461","last_updated":"2025-05-29T14:45:58Z","snapshot_observed_at":"2026-08-18T01:04:18.961194Z","submitted_at":"2025-05-28T15:16:15Z","title":"SHTOcc: Effective 3D Occupancy Prediction with Sparse Head and Tail Voxels","version":2},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-07T13:11:40.825468Z"},"links":{"citing_paper":"/paper/2505.22461"},"observation_digest":"sha256:6ef1493704d0a110b802c0fa442e63af4ab4015714ffd67e821523267de638e6","observation_id":"f2a56f83-9446-488e-9b1d-987d9cf3cc7f","resolution":{"observed_at":"2026-08-07T13:11:51.011393Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2412.07163","last_updated":"2024-12-10T03:46:03Z","snapshot_observed_at":"2026-08-18T01:05:16.812509Z","submitted_at":"2024-12-10T03:46:03Z","title":"Fast Occupancy Network","version":1},"cited_work":{"arxiv_id":"2412.07163","doi":null,"metadata_source":"pith","pith_arxiv_id":"2412.07163","snapshot_observed_at":"2026-08-07T13:11:47.321885Z","title":"Fast Occupancy Network","venue":"cs.CV","work_id":"8302f7fd-aaa1-4d79-9108-38132f8b593e","year":2024},"citing_paper":{"arxiv_id":"2505.22461","last_updated":"2025-05-29T14:45:58Z","snapshot_observed_at":"2026-08-18T01:04:18.961194Z","submitted_at":"2025-05-28T15:16:15Z","title":"SHTOcc: Effective 3D Occupancy Prediction with Sparse Head and Tail Voxels","version":2},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-07T13:11:40.976628Z"},"links":{"cited_paper":"/paper/2412.07163","citing_paper":"/paper/2505.22461"},"observation_digest":"sha256:b691f835dae32d3975d88c877997ac631bef4f6ae1dc1e5d197bf93319f212d5","observation_id":"8887eb1b-217a-470c-8cfe-85cee1e0c91c","resolution":{"observed_at":"2026-08-07T13:11:47.394085Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2408.11464","last_updated":"2024-08-21T09:29:45Z","snapshot_observed_at":"2026-08-16T13:24:57.431671Z","submitted_at":"2024-08-21T09:29:45Z","title":"MambaOcc: Visual State Space Model for BEV-based Occupancy Prediction with Local Adaptive Reordering","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2408.11464","snapshot_observed_at":"2026-08-07T13:11:41.238293Z","title":"Mambaocc: Visual state space model for bev-based occupancy prediction with local adaptive reordering,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.22461","last_updated":"2025-05-29T14:45:58Z","snapshot_observed_at":"2026-08-18T01:04:18.961194Z","submitted_at":"2025-05-28T15:16:15Z","title":"SHTOcc: Effective 3D Occupancy Prediction with Sparse Head and Tail Voxels","version":2},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-07T13:11:41.238293Z"},"links":{"cited_paper":"/paper/2408.11464","citing_paper":"/paper/2505.22461"},"observation_digest":"sha256:8ae16c57807afc80af32e509c48febae0f9d2ef7c03bbfd8e8d8d58fef4b6d97","observation_id":"5595c955-8295-4fd2-a29c-4f1b6ce04e07","resolution":{"observed_at":"2026-08-07T13:11:41.238293Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2311.12058","last_updated":"2023-11-18T15:28:09Z","snapshot_observed_at":"2026-08-16T14:42:10.713390Z","submitted_at":"2023-11-18T15:28:09Z","title":"FlashOcc: Fast and Memory-Efficient Occupancy Prediction via Channel-to-Height Plugin","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2311.12058","snapshot_observed_at":"2026-08-07T13:11:41.381188Z","title":"Flashocc: Fast and memory-efficient occupancy prediction via channel-to-height plugin,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.22461","last_updated":"2025-05-29T14:45:58Z","snapshot_observed_at":"2026-08-18T01:04:18.961194Z","submitted_at":"2025-05-28T15:16:15Z","title":"SHTOcc: Effective 3D Occupancy Prediction with Sparse Head and Tail Voxels","version":2},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-07T13:11:41.381188Z"},"links":{"cited_paper":"/paper/2311.12058","citing_paper":"/paper/2505.22461"},"observation_digest":"sha256:9c2ef12ee20540686fced6664dfe5c4d9f15ea79ac92834ede279d2794846e27","observation_id":"bf7e8efc-aabd-48c3-be53-1eed70ec74b3","resolution":{"observed_at":"2026-08-07T13:11:41.381188Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:11:50.679227Z","title":"Cotr: Compact occupancy transformer for vision-based 3d occupancy prediction,","venue":null,"work_id":"918614bf-334e-4a0f-a65d-7abf7bf2ce74","year":2024},"citing_paper":{"arxiv_id":"2505.22461","last_updated":"2025-05-29T14:45:58Z","snapshot_observed_at":"2026-08-18T01:04:18.961194Z","submitted_at":"2025-05-28T15:16:15Z","title":"SHTOcc: Effective 3D Occupancy Prediction with Sparse Head and Tail Voxels","version":2},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-07T13:11:41.508048Z"},"links":{"citing_paper":"/paper/2505.22461"},"observation_digest":"sha256:565ef5ad5fff2eb6ca698aff7c921c203faf650b6811c63e14d3e6143870295a","observation_id":"d32af923-cd98-454e-9d67-a361f6b1254d","resolution":{"observed_at":"2026-08-07T13:11:50.762400Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2504.12959","last_updated":"2025-04-18T15:58:20Z","snapshot_observed_at":"2026-08-18T12:36:44.199141Z","submitted_at":"2025-04-17T14:05:33Z","title":"Rethinking Temporal Fusion with a Unified Gradient Descent View for 3D Semantic Occupancy Prediction","version":2},"cited_work":{"arxiv_id":"2504.12959","doi":null,"metadata_source":"pith","pith_arxiv_id":"2504.12959","snapshot_observed_at":"2026-08-07T13:11:47.059270Z","title":"Rethinking Temporal Fusion with a Unified Gradient Descent View for 3D Semantic Occupancy Prediction","venue":"cs.CV","work_id":"eccbc547-e6f8-4b37-a0db-7eecf2efb739","year":2025},"citing_paper":{"arxiv_id":"2505.22461","last_updated":"2025-05-29T14:45:58Z","snapshot_observed_at":"2026-08-18T01:04:18.961194Z","submitted_at":"2025-05-28T15:16:15Z","title":"SHTOcc: Effective 3D Occupancy Prediction with Sparse Head and Tail Voxels","version":2},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-07T13:11:41.595989Z"},"links":{"cited_paper":"/paper/2504.12959","citing_paper":"/paper/2505.22461"},"observation_digest":"sha256:7e8c97061c6336e370e6167fc3111412011ec5c10fb7a21f807243bce8f935c0","observation_id":"6bb53eca-c7a1-4334-bad2-0b6c78868994","resolution":{"observed_at":"2026-08-07T13:11:47.133805Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2504.19749","last_updated":"2025-04-28T12:49:20Z","snapshot_observed_at":"2026-08-17T05:16:46.616755Z","submitted_at":"2025-04-28T12:49:20Z","title":"STCOcc: Sparse Spatial-Temporal Cascade Renovation for 3D Occupancy and Scene Flow Prediction","version":1},"cited_work":{"arxiv_id":"2504.19749","doi":null,"metadata_source":"pith","pith_arxiv_id":"2504.19749","snapshot_observed_at":"2026-08-07T13:11:46.872677Z","title":"STCOcc: Sparse Spatial-Temporal Cascade Renovation for 3D Occupancy and Scene Flow Prediction","venue":"cs.CV","work_id":"f474eb81-1e60-4b7d-b1c0-3c6d5e3ba009","year":2025},"citing_paper":{"arxiv_id":"2505.22461","last_updated":"2025-05-29T14:45:58Z","snapshot_observed_at":"2026-08-18T01:04:18.961194Z","submitted_at":"2025-05-28T15:16:15Z","title":"SHTOcc: Effective 3D Occupancy Prediction with Sparse Head and Tail Voxels","version":2},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-07T13:11:41.708670Z"},"links":{"cited_paper":"/paper/2504.19749","citing_paper":"/paper/2505.22461"},"observation_digest":"sha256:57ac2399793fe5dc2d3fa6d5e2feba9156dcd0d3303d2a6054888b107d765491","observation_id":"711e19c7-9a4f-4990-bbb3-3487ad380752","resolution":{"observed_at":"2026-08-07T13:11:46.918335Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:11:50.527760Z","title":"Tri-perspective view for vision-based 3d semantic occupancy prediction,","venue":null,"work_id":"1e297ff1-2b05-423d-aa49-6468fe40a0c5","year":2023},"citing_paper":{"arxiv_id":"2505.22461","last_updated":"2025-05-29T14:45:58Z","snapshot_observed_at":"2026-08-18T01:04:18.961194Z","submitted_at":"2025-05-28T15:16:15Z","title":"SHTOcc: Effective 3D Occupancy Prediction with Sparse Head and Tail Voxels","version":2},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-07T13:11:41.865677Z"},"links":{"citing_paper":"/paper/2505.22461"},"observation_digest":"sha256:ab83f5c2b3fd66922c630ee212af1fd2349eb68e414841b6e2f2c9ae86dc75c3","observation_id":"128deb67-1e5c-483c-b33b-6d82f5772dde","resolution":{"observed_at":"2026-08-07T13:11:50.587655Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2412.05976","last_updated":"2026-06-21T15:24:02Z","snapshot_observed_at":"2026-08-11T20:06:13.348654Z","submitted_at":"2024-12-08T15:49:35Z","title":"LightOcc: Lightweight Spatial Embedding for Efficient Vision-based 3D Occupancy Prediction","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2412.05976","snapshot_observed_at":"2026-08-07T13:11:42.031285Z","title":"Lightweight spatial embedding for vision-based 3d occupancy prediction,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.22461","last_updated":"2025-05-29T14:45:58Z","snapshot_observed_at":"2026-08-18T01:04:18.961194Z","submitted_at":"2025-05-28T15:16:15Z","title":"SHTOcc: Effective 3D Occupancy Prediction with Sparse Head and Tail Voxels","version":2},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-07T13:11:42.031285Z"},"links":{"cited_paper":"/paper/2412.05976","citing_paper":"/paper/2505.22461"},"observation_digest":"sha256:119e0f619ae709f1678162c17c8cbedf704e6d30b134b932a03bddfb0e44f7b9","observation_id":"bfdfcc99-418c-4f83-9eb5-d1cce5725f29","resolution":{"observed_at":"2026-08-07T13:11:42.031285Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2410.11019","last_updated":"2025-03-01T18:48:48Z","snapshot_observed_at":"2026-08-16T13:09:26.694622Z","submitted_at":"2024-10-14T19:14:49Z","title":"ET-Former: Efficient Triplane Deformable Attention for 3D Semantic Scene Completion From Monocular Camera","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2410.11019","snapshot_observed_at":"2026-08-07T13:11:42.201312Z","title":"Et-former: Efficient triplane deformable attention for 3d semantic scene completion from monocular camera,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.22461","last_updated":"2025-05-29T14:45:58Z","snapshot_observed_at":"2026-08-18T01:04:18.961194Z","submitted_at":"2025-05-28T15:16:15Z","title":"SHTOcc: Effective 3D Occupancy Prediction with Sparse Head and Tail Voxels","version":2},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-07T13:11:42.201312Z"},"links":{"cited_paper":"/paper/2410.11019","citing_paper":"/paper/2505.22461"},"observation_digest":"sha256:9d9e72faf057386ca2abb73a61882f68c07612e986a601eb5dbe1e3de2c40c0b","observation_id":"538085b9-b515-4912-85d4-2324f9c8d61e","resolution":{"observed_at":"2026-08-07T13:11:42.201312Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:11:50.367117Z","title":"Gaussianformer: Scene as gaussians for vision-based 3d semantic occupancy prediction,","venue":null,"work_id":"ef0c3f02-a55e-4ee4-b048-92678467db78","year":2024},"citing_paper":{"arxiv_id":"2505.22461","last_updated":"2025-05-29T14:45:58Z","snapshot_observed_at":"2026-08-18T01:04:18.961194Z","submitted_at":"2025-05-28T15:16:15Z","title":"SHTOcc: Effective 3D Occupancy Prediction with Sparse Head and Tail Voxels","version":2},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-07T13:11:42.313799Z"},"links":{"citing_paper":"/paper/2505.22461"},"observation_digest":"sha256:f7322f9272635e9a0b0a4b45d05b409c9f48d5034279be6b8bc631c7542e08af","observation_id":"1a3d3885-8ed6-4e98-8462-2885b757fe35","resolution":{"observed_at":"2026-08-07T13:11:50.440272Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2412.13193","last_updated":"2025-03-24T12:45:56Z","snapshot_observed_at":"2026-08-13T10:33:17.381595Z","submitted_at":"2024-12-17T18:59:46Z","title":"GaussTR: Foundation Model-Aligned Gaussian Transformer for Self-Supervised 3D Spatial Understanding","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2412.13193","snapshot_observed_at":"2026-08-07T13:11:42.471135Z","title":"Gausstr: Foundation model-aligned gaussian transformer for self-supervised 3d spatial understanding,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.22461","last_updated":"2025-05-29T14:45:58Z","snapshot_observed_at":"2026-08-18T01:04:18.961194Z","submitted_at":"2025-05-28T15:16:15Z","title":"SHTOcc: Effective 3D Occupancy Prediction with Sparse Head and Tail Voxels","version":2},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-07T13:11:42.471135Z"},"links":{"cited_paper":"/paper/2412.13193","citing_paper":"/paper/2505.22461"},"observation_digest":"sha256:317203080c9bf78f4e2cb443d810335f3c52f29d4c9e697f13d29b0d45fb7984","observation_id":"c0d3d367-a5f4-4af9-b659-1a023e986f07","resolution":{"observed_at":"2026-08-07T13:11:42.471135Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2412.04384","last_updated":"2024-12-06T15:43:40Z","snapshot_observed_at":"2026-08-17T12:08:46.064430Z","submitted_at":"2024-12-05T17:59:58Z","title":"GaussianFormer-2: Probabilistic Gaussian Superposition for Efficient 3D Occupancy Prediction","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2412.04384","snapshot_observed_at":"2026-08-07T13:11:42.588256Z","title":"Probabilistic gaussian superposition for efficient 3d occupancy prediction,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.22461","last_updated":"2025-05-29T14:45:58Z","snapshot_observed_at":"2026-08-18T01:04:18.961194Z","submitted_at":"2025-05-28T15:16:15Z","title":"SHTOcc: Effective 3D Occupancy Prediction with Sparse Head and Tail Voxels","version":2},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-07T13:11:42.588256Z"},"links":{"cited_paper":"/paper/2412.04384","citing_paper":"/paper/2505.22461"},"observation_digest":"sha256:5c630797e5f1dbc138191a3fd92c891b2a565f3875c9b264571c84bbf90f3bab","observation_id":"aac0a6e5-27bc-42cd-b517-239317a8aadb","resolution":{"observed_at":"2026-08-07T13:11:42.588256Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2409.09350","last_updated":"2024-10-31T01:39:52Z","snapshot_observed_at":"2026-08-18T04:03:08.805907Z","submitted_at":"2024-09-14T07:44:22Z","title":"OPUS: Occupancy Prediction Using a Sparse Set","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2409.09350","snapshot_observed_at":"2026-08-07T13:11:42.740268Z","title":"Opus: occupancy prediction using a sparse set,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.22461","last_updated":"2025-05-29T14:45:58Z","snapshot_observed_at":"2026-08-18T01:04:18.961194Z","submitted_at":"2025-05-28T15:16:15Z","title":"SHTOcc: Effective 3D Occupancy Prediction with Sparse Head and Tail Voxels","version":2},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-07T13:11:42.740268Z"},"links":{"cited_paper":"/paper/2409.09350","citing_paper":"/paper/2505.22461"},"observation_digest":"sha256:4e32fe8a93d214c14e032e3ceb870e47f1028a270ae91087fc055534e63628b4","observation_id":"20366191-543c-46e4-9b89-da95e76da1d2","resolution":{"observed_at":"2026-08-07T13:11:42.740268Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:11:50.141290Z","title":"Fully sparse 3d occupancy prediction,","venue":null,"work_id":"6ab3078e-aa1f-4e82-abde-c7956578b106","year":2024},"citing_paper":{"arxiv_id":"2505.22461","last_updated":"2025-05-29T14:45:58Z","snapshot_observed_at":"2026-08-18T01:04:18.961194Z","submitted_at":"2025-05-28T15:16:15Z","title":"SHTOcc: Effective 3D Occupancy Prediction with Sparse Head and Tail Voxels","version":2},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-07T13:11:42.882800Z"},"links":{"citing_paper":"/paper/2505.22461"},"observation_digest":"sha256:ff5a4f6488ca087808e0af05b55ec6c556b150812d066244d0ea73125139277f","observation_id":"bb6e1018-c94c-4685-8f1b-741bba448bcd","resolution":{"observed_at":"2026-08-07T13:11:50.254583Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:11:49.968118Z","title":"Sparseocc: Rethinking sparse latent representation for vision-based semantic occupancy prediction,","venue":null,"work_id":"860a3186-adbf-49ce-8630-aefd7610db40","year":2024},"citing_paper":{"arxiv_id":"2505.22461","last_updated":"2025-05-29T14:45:58Z","snapshot_observed_at":"2026-08-18T01:04:18.961194Z","submitted_at":"2025-05-28T15:16:15Z","title":"SHTOcc: Effective 3D Occupancy Prediction with Sparse Head and Tail Voxels","version":2},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-07T13:11:42.992620Z"},"links":{"citing_paper":"/paper/2505.22461"},"observation_digest":"sha256:84ae6d0f94e8b9b0e65a5eb0c24f080b83d260419213d545207c607ae0b54fed","observation_id":"8979f0db-01ba-4ebb-a16f-8e4023392d89","resolution":{"observed_at":"2026-08-07T13:11:50.038282Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2503.15185","last_updated":"2025-03-19T13:14:57Z","snapshot_observed_at":"2026-08-16T12:48:37.837734Z","submitted_at":"2025-03-19T13:14:57Z","title":"3D Occupancy Prediction with Low-Resolution Queries via Prototype-aware View Transformation","version":1},"cited_work":{"arxiv_id":"2503.15185","doi":null,"metadata_source":"pith","pith_arxiv_id":"2503.15185","snapshot_observed_at":"2026-08-07T13:11:46.501747Z","title":"3D Occupancy Prediction with Low-Resolution Queries via Prototype-aware View Transformation","venue":"cs.CV","work_id":"9461208a-a54a-4a97-9757-01958c356351","year":2025},"citing_paper":{"arxiv_id":"2505.22461","last_updated":"2025-05-29T14:45:58Z","snapshot_observed_at":"2026-08-18T01:04:18.961194Z","submitted_at":"2025-05-28T15:16:15Z","title":"SHTOcc: Effective 3D Occupancy Prediction with Sparse Head and Tail Voxels","version":2},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-07T13:11:43.133524Z"},"links":{"cited_paper":"/paper/2503.15185","citing_paper":"/paper/2505.22461"},"observation_digest":"sha256:d39a1e55d88abfeed3450d7a5d4892252476adf486ce50477f16976249216d2d","observation_id":"cc12812f-f27d-4d29-a6b1-98768a4a9b1e","resolution":{"observed_at":"2026-08-07T13:11:46.597300Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:11:49.835996Z","title":"Long-tailed recognition via weight balancing,","venue":null,"work_id":"7c513b74-ff73-4d3b-98ac-3e6eb3effd64","year":2022},"citing_paper":{"arxiv_id":"2505.22461","last_updated":"2025-05-29T14:45:58Z","snapshot_observed_at":"2026-08-18T01:04:18.961194Z","submitted_at":"2025-05-28T15:16:15Z","title":"SHTOcc: Effective 3D Occupancy Prediction with Sparse Head and Tail Voxels","version":2},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-07T13:11:43.332389Z"},"links":{"citing_paper":"/paper/2505.22461"},"observation_digest":"sha256:484772c4921ba9c6e79a362782c104c44df28d191fa2bd3df7987895525d8620","observation_id":"6c0260c6-aee4-438a-8d02-950a24c2194f","resolution":{"observed_at":"2026-08-07T13:11:49.890151Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:11:49.661246Z","title":"The devil is in classification: A simple framework for long-tail instance segmentation,","venue":null,"work_id":"96e4fb53-9c6d-4e0b-b5d1-43c93d954752","year":2020},"citing_paper":{"arxiv_id":"2505.22461","last_updated":"2025-05-29T14:45:58Z","snapshot_observed_at":"2026-08-18T01:04:18.961194Z","submitted_at":"2025-05-28T15:16:15Z","title":"SHTOcc: Effective 3D Occupancy Prediction with Sparse Head and Tail Voxels","version":2},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-08-07T13:11:43.456067Z"},"links":{"citing_paper":"/paper/2505.22461"},"observation_digest":"sha256:9de3671c7f64f88ee8a495bbbae123caea40f4803f30971415ba302b4de20487","observation_id":"cd073f3b-8513-4deb-a6bc-3ec904893e81","resolution":{"observed_at":"2026-08-07T13:11:49.730296Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1910.09217","last_updated":"2020-02-19T15:51:25Z","snapshot_observed_at":"2026-08-17T22:53:45.876807Z","submitted_at":"2019-10-21T09:03:19Z","title":"Decoupling Representation and Classifier for Long-Tailed Recognition","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1910.09217","snapshot_observed_at":"2026-08-07T13:11:43.531974Z","title":"Decoupling representation and classifier for long-tailed recognition,","venue":null,"work_id":null,"year":1910},"citing_paper":{"arxiv_id":"2505.22461","last_updated":"2025-05-29T14:45:58Z","snapshot_observed_at":"2026-08-18T01:04:18.961194Z","submitted_at":"2025-05-28T15:16:15Z","title":"SHTOcc: Effective 3D Occupancy Prediction with Sparse Head and Tail Voxels","version":2},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-08-07T13:11:43.531974Z"},"links":{"cited_paper":"/paper/1910.09217","citing_paper":"/paper/2505.22461"},"observation_digest":"sha256:a7437d1255f78369fd7c4cfee91b0575cb4e99d9559e3374cf2e406e2d3cc07c","observation_id":"ff4e3154-6147-452e-828f-956cdffff196","resolution":{"observed_at":"2026-08-07T13:11:43.531974Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:11:43.638404Z","title":"Occ3d: A large-scale 3d occupancy prediction benchmark for autonomous driving,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.22461","last_updated":"2025-05-29T14:45:58Z","snapshot_observed_at":"2026-08-18T01:04:18.961194Z","submitted_at":"2025-05-28T15:16:15Z","title":"SHTOcc: Effective 3D Occupancy Prediction with Sparse Head and Tail Voxels","version":2},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-08-07T13:11:43.638404Z"},"links":{"citing_paper":"/paper/2505.22461"},"observation_digest":"sha256:fefef2c7360c13aebb9618304b273e90a3e08d0999eab41f1ac71dcaade1c421","observation_id":"d4249312-1821-4247-8318-7263a2186c91","resolution":{"observed_at":"2026-08-07T13:11:43.638404Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:11:43.742322Z","title":"Occupancy networks: Learning 3d reconstruction in function space,","venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2505.22461","last_updated":"2025-05-29T14:45:58Z","snapshot_observed_at":"2026-08-18T01:04:18.961194Z","submitted_at":"2025-05-28T15:16:15Z","title":"SHTOcc: Effective 3D Occupancy Prediction with Sparse Head and Tail Voxels","version":2},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-08-07T13:11:43.742322Z"},"links":{"citing_paper":"/paper/2505.22461"},"observation_digest":"sha256:aa42619b58162abe529282fd328fe52c2f88c1199d3471aca98df1d99dcf5c57","observation_id":"7221a046-2d1f-42e0-b51e-c4b2b405745a","resolution":{"observed_at":"2026-08-07T13:11:43.742322Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:11:49.468426Z","title":"Convolutional occupancy networks,","venue":null,"work_id":"de874ecd-1a55-4a51-b68f-3b50eec668db","year":2020},"citing_paper":{"arxiv_id":"2505.22461","last_updated":"2025-05-29T14:45:58Z","snapshot_observed_at":"2026-08-18T01:04:18.961194Z","submitted_at":"2025-05-28T15:16:15Z","title":"SHTOcc: Effective 3D Occupancy Prediction with Sparse Head and Tail Voxels","version":2},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-08-07T13:11:43.847116Z"},"links":{"citing_paper":"/paper/2505.22461"},"observation_digest":"sha256:bbe543a3329aa45f0d42dbb0ec9ef9c55de88f440ad76ce819334fc1acddfc87","observation_id":"dda3d7e8-ae89-4bfb-a5b7-074cd5f40eeb","resolution":{"observed_at":"2026-08-07T13:11:49.528814Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:11:49.274063Z","title":"Semantic scene completion from a single depth image,","venue":null,"work_id":"fae490e8-b895-4e54-b75f-488427b4b33a","year":2017},"citing_paper":{"arxiv_id":"2505.22461","last_updated":"2025-05-29T14:45:58Z","snapshot_observed_at":"2026-08-18T01:04:18.961194Z","submitted_at":"2025-05-28T15:16:15Z","title":"SHTOcc: Effective 3D Occupancy Prediction with Sparse Head and Tail Voxels","version":2},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-08-07T13:11:43.942255Z"},"links":{"citing_paper":"/paper/2505.22461"},"observation_digest":"sha256:ec06e11b67b037802d22b9c1c0b12676acc64e1a4fc7a28c26957351b1f26066","observation_id":"2ed46270-9eb5-47d9-8efd-0dba91a94dbe","resolution":{"observed_at":"2026-08-07T13:11:49.359320Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:11:44.031674Z","title":"Rgbd based dimensional decomposition residual network for 3d semantic scene completion,","venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2505.22461","last_updated":"2025-05-29T14:45:58Z","snapshot_observed_at":"2026-08-18T01:04:18.961194Z","submitted_at":"2025-05-28T15:16:15Z","title":"SHTOcc: Effective 3D Occupancy Prediction with Sparse Head and Tail Voxels","version":2},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-08-07T13:11:44.031674Z"},"links":{"citing_paper":"/paper/2505.22461"},"observation_digest":"sha256:e248254dcd4f6d1560310b99e62dea58e0e697d0ca7428734fe51fd1717743ba","observation_id":"4ff370a8-eb0c-416b-aef0-8aa0d5df97bc","resolution":{"observed_at":"2026-08-07T13:11:44.031674Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:11:49.114467Z","title":"Cascaded context pyramid for full-resolution 3d semantic scene completion,","venue":null,"work_id":"e450cb32-1f58-4871-bea9-f0cb11706c6b","year":2019},"citing_paper":{"arxiv_id":"2505.22461","last_updated":"2025-05-29T14:45:58Z","snapshot_observed_at":"2026-08-18T01:04:18.961194Z","submitted_at":"2025-05-28T15:16:15Z","title":"SHTOcc: Effective 3D Occupancy Prediction with Sparse Head and Tail Voxels","version":2},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-08-07T13:11:44.139588Z"},"links":{"citing_paper":"/paper/2505.22461"},"observation_digest":"sha256:ca9ef5920e06ff7b6bf713116bef9c7341ba3cc41f254a23cd7bc7545a663830","observation_id":"f58931d8-55c5-48ad-9fb3-0ca299cfd2ea","resolution":{"observed_at":"2026-08-07T13:11:49.167501Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1806.05361","last_updated":"2018-06-14T04:42:05Z","snapshot_observed_at":"2026-08-14T19:03:54.624753Z","submitted_at":"2018-06-14T04:42:05Z","title":"View-volume Network for Semantic Scene Completion from a Single Depth Image","version":1},"cited_work":{"arxiv_id":"1806.05361","doi":null,"metadata_source":"pith","pith_arxiv_id":"1806.05361","snapshot_observed_at":"2026-08-07T13:11:46.305265Z","title":"View-volume Network for Semantic Scene Completion from a Single Depth Image","venue":"cs.CV","work_id":"920d3811-4cf9-4760-a476-47443b0916f6","year":2018},"citing_paper":{"arxiv_id":"2505.22461","last_updated":"2025-05-29T14:45:58Z","snapshot_observed_at":"2026-08-18T01:04:18.961194Z","submitted_at":"2025-05-28T15:16:15Z","title":"SHTOcc: Effective 3D Occupancy Prediction with Sparse Head and Tail Voxels","version":2},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-08-07T13:11:44.232494Z"},"links":{"cited_paper":"/paper/1806.05361","citing_paper":"/paper/2505.22461"},"observation_digest":"sha256:8db98ca650150f511471ee406acd3eb51215bdaa9ed9ae19682665bdefa697b9","observation_id":"20713034-1fcb-4a66-9c53-db4cdb0ca9bf","resolution":{"observed_at":"2026-08-07T13:11:46.365226Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:11:44.296858Z","title":"Anisotropic convolutional networks for 3d semantic scene completion,","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2505.22461","last_updated":"2025-05-29T14:45:58Z","snapshot_observed_at":"2026-08-18T01:04:18.961194Z","submitted_at":"2025-05-28T15:16:15Z","title":"SHTOcc: Effective 3D Occupancy Prediction with Sparse Head and Tail Voxels","version":2},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-08-07T13:11:44.296858Z"},"links":{"citing_paper":"/paper/2505.22461"},"observation_digest":"sha256:b95750c8e70e3c5b65f707bd9d3757d1914fc9b8e1c2516db7c08647b5379f75","observation_id":"2b7ffb93-d0c1-470f-b457-a678c6303ec1","resolution":{"observed_at":"2026-08-07T13:11:44.296858Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:11:48.956708Z","title":"See and think: Disentangling semantic scene completion,","venue":null,"work_id":"0bd663a3-644e-4afc-9519-aa9daf4632ea","year":2018},"citing_paper":{"arxiv_id":"2505.22461","last_updated":"2025-05-29T14:45:58Z","snapshot_observed_at":"2026-08-18T01:04:18.961194Z","submitted_at":"2025-05-28T15:16:15Z","title":"SHTOcc: Effective 3D Occupancy Prediction with Sparse Head and Tail Voxels","version":2},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-08-07T13:11:44.438242Z"},"links":{"citing_paper":"/paper/2505.22461"},"observation_digest":"sha256:79513c8a33cef9aaa81ec8a85bf5eb8ebe4ab2a5b5493d3a110841cfb534338d","observation_id":"d2ddca64-5891-4868-9989-25f1e0e0b8de","resolution":{"observed_at":"2026-08-07T13:11:49.024825Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:11:44.520674Z","title":"Monoscene: Monocular 3d semantic scene completion,","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2505.22461","last_updated":"2025-05-29T14:45:58Z","snapshot_observed_at":"2026-08-18T01:04:18.961194Z","submitted_at":"2025-05-28T15:16:15Z","title":"SHTOcc: Effective 3D Occupancy Prediction with Sparse Head and Tail Voxels","version":2},"reference_index":36,"source":"pdf_text","source_observed_at":"2026-08-07T13:11:44.520674Z"},"links":{"citing_paper":"/paper/2505.22461"},"observation_digest":"sha256:91fc522d3cb313fca64afac43f6c2a0ae9db3208c6f637db66dc1c9948aeec4d","observation_id":"a9e0a018-9e3c-41c8-aa14-0644a4689792","resolution":{"observed_at":"2026-08-07T13:11:44.520674Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:11:44.625958Z","title":"V oxformer: Sparse voxel transformer for camera-based 3d semantic scene completion,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.22461","last_updated":"2025-05-29T14:45:58Z","snapshot_observed_at":"2026-08-18T01:04:18.961194Z","submitted_at":"2025-05-28T15:16:15Z","title":"SHTOcc: Effective 3D Occupancy Prediction with Sparse Head and Tail Voxels","version":2},"reference_index":37,"source":"pdf_text","source_observed_at":"2026-08-07T13:11:44.625958Z"},"links":{"citing_paper":"/paper/2505.22461"},"observation_digest":"sha256:22d809837b9df273fde7796685271b0cbac62e4b4f7244604003fb1ff534a4de","observation_id":"92247f66-8736-42c6-832f-8b778c5156d9","resolution":{"observed_at":"2026-08-07T13:11:44.625958Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2302.13540","last_updated":"2023-02-27T06:35:03Z","snapshot_observed_at":"2026-08-16T15:52:32.847801Z","submitted_at":"2023-02-27T06:35:03Z","title":"OccDepth: A Depth-Aware Method for 3D Semantic Scene Completion","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2302.13540","snapshot_observed_at":"2026-08-07T13:11:44.748461Z","title":"Occdepth: A depth-aware method for 3d semantic scene completion,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.22461","last_updated":"2025-05-29T14:45:58Z","snapshot_observed_at":"2026-08-18T01:04:18.961194Z","submitted_at":"2025-05-28T15:16:15Z","title":"SHTOcc: Effective 3D Occupancy Prediction with Sparse Head and Tail Voxels","version":2},"reference_index":38,"source":"pdf_text","source_observed_at":"2026-08-07T13:11:44.748461Z"},"links":{"cited_paper":"/paper/2302.13540","citing_paper":"/paper/2505.22461"},"observation_digest":"sha256:e5bd1bd369c3059803b87c16c20687afe3b0cbc551a705eda34c59aa5a935d26","observation_id":"3d8d1c4c-46bc-4e6c-8ef6-f1e141df383c","resolution":{"observed_at":"2026-08-07T13:11:44.748461Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:11:48.790352Z","title":"Ndc-scene: Boost monocular 3d semantic scene completion in normalized device coordinates space,","venue":null,"work_id":"3f095bce-8a26-4c54-8f15-a9c6ef9e7bdc","year":2023},"citing_paper":{"arxiv_id":"2505.22461","last_updated":"2025-05-29T14:45:58Z","snapshot_observed_at":"2026-08-18T01:04:18.961194Z","submitted_at":"2025-05-28T15:16:15Z","title":"SHTOcc: Effective 3D Occupancy Prediction with Sparse Head and Tail Voxels","version":2},"reference_index":39,"source":"pdf_text","source_observed_at":"2026-08-07T13:11:44.837295Z"},"links":{"citing_paper":"/paper/2505.22461"},"observation_digest":"sha256:3bcd1acac79132816e124337dfeea7c4a3190b2bf67d38469790778b6d755c2b","observation_id":"1bbd591c-cb50-420c-bb1c-633e3c64b86c","resolution":{"observed_at":"2026-08-07T13:11:48.837236Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:11:44.892643Z","title":"Scene as occupancy,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.22461","last_updated":"2025-05-29T14:45:58Z","snapshot_observed_at":"2026-08-18T01:04:18.961194Z","submitted_at":"2025-05-28T15:16:15Z","title":"SHTOcc: Effective 3D Occupancy Prediction with Sparse Head and Tail Voxels","version":2},"reference_index":40,"source":"pdf_text","source_observed_at":"2026-08-07T13:11:44.892643Z"},"links":{"citing_paper":"/paper/2505.22461"},"observation_digest":"sha256:079f3f5fe0b305026e4bcc2e689fd2d7345a3bb1928349d57d9ba0f499579e30","observation_id":"fbc727c5-bceb-4c5e-99b0-505c4b5f4dfb","resolution":{"observed_at":"2026-08-07T13:11:44.892643Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:11:48.564367Z","title":"Rethinking classifier re-training in long-tailed recognition: Label over-smooth can balance,","venue":null,"work_id":"d4828abf-a489-4515-8451-0cd5bcda23a2","year":null},"citing_paper":{"arxiv_id":"2505.22461","last_updated":"2025-05-29T14:45:58Z","snapshot_observed_at":"2026-08-18T01:04:18.961194Z","submitted_at":"2025-05-28T15:16:15Z","title":"SHTOcc: Effective 3D Occupancy Prediction with Sparse Head and Tail Voxels","version":2},"reference_index":41,"source":"pdf_text","source_observed_at":"2026-08-07T13:11:44.979866Z"},"links":{"citing_paper":"/paper/2505.22461"},"observation_digest":"sha256:93b7b15950dab686ed8749e76a6abde07a4c98a9c244d88a5787977c4c68abb9","observation_id":"9e5af5db-4700-4d4a-946c-acf9d6dfc5ce","resolution":{"observed_at":"2026-08-07T13:11:48.673546Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:11:48.360950Z","title":"Not all voxels are equal: Hardness- aware semantic scene completion with self-distillation,","venue":null,"work_id":"d112674d-b2b3-4f2c-aa43-c6e8c6a942f1","year":2024},"citing_paper":{"arxiv_id":"2505.22461","last_updated":"2025-05-29T14:45:58Z","snapshot_observed_at":"2026-08-18T01:04:18.961194Z","submitted_at":"2025-05-28T15:16:15Z","title":"SHTOcc: Effective 3D Occupancy Prediction with Sparse Head and Tail Voxels","version":2},"reference_index":42,"source":"pdf_text","source_observed_at":"2026-08-07T13:11:45.048985Z"},"links":{"citing_paper":"/paper/2505.22461"},"observation_digest":"sha256:17edf2b5330c00bb2075faacb322cb0a9120a6a87c7ceb718171b7c563a4e221","observation_id":"5c09ab91-0e0f-47bc-9488-8a2de905fc23","resolution":{"observed_at":"2026-08-07T13:11:48.432495Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:11:45.178841Z","title":"Symphonize 3d semantic scene completion with contextual instance queries,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.22461","last_updated":"2025-05-29T14:45:58Z","snapshot_observed_at":"2026-08-18T01:04:18.961194Z","submitted_at":"2025-05-28T15:16:15Z","title":"SHTOcc: Effective 3D Occupancy Prediction with Sparse Head and Tail Voxels","version":2},"reference_index":43,"source":"pdf_text","source_observed_at":"2026-08-07T13:11:45.178841Z"},"links":{"citing_paper":"/paper/2505.22461"},"observation_digest":"sha256:5d9dd5d87b2fde1863fc23d6640790b4bf30b3b8ac816d9793bb998ab50b4099","observation_id":"53a7b028-2e5a-4caa-873c-877838f43d58","resolution":{"observed_at":"2026-08-07T13:11:45.178841Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:11:45.275126Z","title":"Lmscnet: Lightweight multiscale 3d semantic completion,","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2505.22461","last_updated":"2025-05-29T14:45:58Z","snapshot_observed_at":"2026-08-18T01:04:18.961194Z","submitted_at":"2025-05-28T15:16:15Z","title":"SHTOcc: Effective 3D Occupancy Prediction with Sparse Head and Tail Voxels","version":2},"reference_index":44,"source":"pdf_text","source_observed_at":"2026-08-07T13:11:45.275126Z"},"links":{"citing_paper":"/paper/2505.22461"},"observation_digest":"sha256:3962e4fb254b1f4d9e9f3988981b1dbac84e169d769fae24c29d6cf077ecf21b","observation_id":"f1a1b084-9815-4f96-805e-03e8173e0090","resolution":{"observed_at":"2026-08-07T13:11:45.275126Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:11:45.355300Z","title":"Sparse single sweep lidar point cloud segmentation via learning contextual shape priors from scene completion,","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2505.22461","last_updated":"2025-05-29T14:45:58Z","snapshot_observed_at":"2026-08-18T01:04:18.961194Z","submitted_at":"2025-05-28T15:16:15Z","title":"SHTOcc: Effective 3D Occupancy Prediction with Sparse Head and Tail Voxels","version":2},"reference_index":45,"source":"pdf_text","source_observed_at":"2026-08-07T13:11:45.355300Z"},"links":{"citing_paper":"/paper/2505.22461"},"observation_digest":"sha256:ac28b49378a4ce2aa573abf494370eeb188706c8f3c725124706d8a7a5b32ffa","observation_id":"ba40f080-5896-4224-91a7-bcecd3e6a027","resolution":{"observed_at":"2026-08-07T13:11:45.355300Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2203.17270","last_updated":"2022-07-13T06:57:28Z","snapshot_observed_at":"2026-08-16T21:18:10.684128Z","submitted_at":"2022-03-31T17:59:01Z","title":"BEVFormer: Learning Bird's-Eye-View Representation from Multi-Camera Images via Spatiotemporal Transformers","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2203.17270","snapshot_observed_at":"2026-08-07T13:11:45.426681Z","title":"Bevformer: Learning bird’s-eye-view representation from multi-camera images via spatiotemporal transformers,","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2505.22461","last_updated":"2025-05-29T14:45:58Z","snapshot_observed_at":"2026-08-18T01:04:18.961194Z","submitted_at":"2025-05-28T15:16:15Z","title":"SHTOcc: Effective 3D Occupancy Prediction with Sparse Head and Tail Voxels","version":2},"reference_index":46,"source":"pdf_text","source_observed_at":"2026-08-07T13:11:45.426681Z"},"links":{"cited_paper":"/paper/2203.17270","citing_paper":"/paper/2505.22461"},"observation_digest":"sha256:7008ce547aaa11fef921da71534ce19555b79343a783cc2fe084245825102a10","observation_id":"c4908c9d-5c01-49b5-9620-2d62f93274a1","resolution":{"observed_at":"2026-08-07T13:11:45.426681Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:11:48.116378Z","title":"Fb-bev: Bev representation from forward-backward view transformations,","venue":null,"work_id":"064eec0f-6081-4efa-b57b-77fce0d4005e","year":2023},"citing_paper":{"arxiv_id":"2505.22461","last_updated":"2025-05-29T14:45:58Z","snapshot_observed_at":"2026-08-18T01:04:18.961194Z","submitted_at":"2025-05-28T15:16:15Z","title":"SHTOcc: Effective 3D Occupancy Prediction with Sparse Head and Tail Voxels","version":2},"reference_index":47,"source":"pdf_text","source_observed_at":"2026-08-07T13:11:45.493457Z"},"links":{"citing_paper":"/paper/2505.22461"},"observation_digest":"sha256:0e297f68bc4086bef48e0c917c11624a48a3e5f5f002976f0935049cd9fa59db","observation_id":"036f6ba3-c31c-4bc1-bf36-374477eb4ec3","resolution":{"observed_at":"2026-08-07T13:11:48.183987Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:11:45.531294Z","title":"Panoocc: Unified occupancy representation for camera-based 3d panoptic segmentation,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.22461","last_updated":"2025-05-29T14:45:58Z","snapshot_observed_at":"2026-08-18T01:04:18.961194Z","submitted_at":"2025-05-28T15:16:15Z","title":"SHTOcc: Effective 3D Occupancy Prediction with Sparse Head and Tail Voxels","version":2},"reference_index":48,"source":"pdf_text","source_observed_at":"2026-08-07T13:11:45.531294Z"},"links":{"citing_paper":"/paper/2505.22461"},"observation_digest":"sha256:f68e69b069335ffaca87352558e83a6516e2071e69c6d85ccdb6c633c2d87402","observation_id":"49509b24-01c0-4a3d-b623-fdf68d3d7fd6","resolution":{"observed_at":"2026-08-07T13:11:45.531294Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:11:47.943346Z","title":"Protoocc: Accurate, efficient 3d occupancy prediction using dual branch encoder-prototype query decoder,","venue":null,"work_id":"d98b9a99-f8a6-493b-a9e0-59d4a0a7b887","year":2025},"citing_paper":{"arxiv_id":"2505.22461","last_updated":"2025-05-29T14:45:58Z","snapshot_observed_at":"2026-08-18T01:04:18.961194Z","submitted_at":"2025-05-28T15:16:15Z","title":"SHTOcc: Effective 3D Occupancy Prediction with Sparse Head and Tail Voxels","version":2},"reference_index":49,"source":"pdf_text","source_observed_at":"2026-08-07T13:11:45.596783Z"},"links":{"citing_paper":"/paper/2505.22461"},"observation_digest":"sha256:f75c9c7bbf301c76e6d398ac106f8fefba35855f31c7d5645855e961f82c3494","observation_id":"598ac190-026b-4534-b752-ccb1804b7e5b","resolution":{"observed_at":"2026-08-07T13:11:47.994823Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:11:45.675204Z","title":"Rangenet++: Fast and accurate lidar semantic segmentation,","venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2505.22461","last_updated":"2025-05-29T14:45:58Z","snapshot_observed_at":"2026-08-18T01:04:18.961194Z","submitted_at":"2025-05-28T15:16:15Z","title":"SHTOcc: Effective 3D Occupancy Prediction with Sparse Head and Tail Voxels","version":2},"reference_index":50,"source":"pdf_text","source_observed_at":"2026-08-07T13:11:45.675204Z"},"links":{"citing_paper":"/paper/2505.22461"},"observation_digest":"sha256:b358a35a0368f1afbe4057ff751016c8bf98e3159df3840887ec314d6e9839c6","observation_id":"c746dc84-b13e-4e03-939d-c5c6c1415035","resolution":{"observed_at":"2026-08-07T13:11:45.675204Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:11:45.761634Z","title":"Polarnet: An improved grid representation for online lidar point clouds semantic segmentation,","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2505.22461","last_updated":"2025-05-29T14:45:58Z","snapshot_observed_at":"2026-08-18T01:04:18.961194Z","submitted_at":"2025-05-28T15:16:15Z","title":"SHTOcc: Effective 3D Occupancy Prediction with Sparse Head and Tail Voxels","version":2},"reference_index":51,"source":"pdf_text","source_observed_at":"2026-08-07T13:11:45.761634Z"},"links":{"citing_paper":"/paper/2505.22461"},"observation_digest":"sha256:3dc3ba2817fd9f4f4278a091fd5e374bf6e29fd5a01e2219ff5e397b57b18ae4","observation_id":"f072d85d-8ba1-4eff-a74b-27856aa76cef","resolution":{"observed_at":"2026-08-07T13:11:45.761634Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:11:47.711831Z","title":"Salsanext: Fast, uncertainty-aware semantic segmentation of lidar point clouds,","venue":null,"work_id":"4fe1b381-dcfb-45ef-997e-742cb4e91d8d","year":2020},"citing_paper":{"arxiv_id":"2505.22461","last_updated":"2025-05-29T14:45:58Z","snapshot_observed_at":"2026-08-18T01:04:18.961194Z","submitted_at":"2025-05-28T15:16:15Z","title":"SHTOcc: Effective 3D Occupancy Prediction with Sparse Head and Tail Voxels","version":2},"reference_index":52,"source":"pdf_text","source_observed_at":"2026-08-07T13:11:45.862298Z"},"links":{"citing_paper":"/paper/2505.22461"},"observation_digest":"sha256:83376ef31e10a3fc629e6f4b2dc5236c9e0440b54315cf42176e674f8d6b776b","observation_id":"0ab92a4d-e105-4d3b-9834-48c12ca87a33","resolution":{"observed_at":"2026-08-07T13:11:47.764779Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:11:45.926386Z","title":"Cylindrical and asymmetrical 3d convolution networks for lidar segmentation,","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2505.22461","last_updated":"2025-05-29T14:45:58Z","snapshot_observed_at":"2026-08-18T01:04:18.961194Z","submitted_at":"2025-05-28T15:16:15Z","title":"SHTOcc: Effective 3D Occupancy Prediction with Sparse Head and Tail Voxels","version":2},"reference_index":53,"source":"pdf_text","source_observed_at":"2026-08-07T13:11:45.926386Z"},"links":{"citing_paper":"/paper/2505.22461"},"observation_digest":"sha256:3a10501f13dcb374f2e3ad8294275b8ef189b1ae22445ccbeed3e75972cfe00a","observation_id":"5eb84f1a-a189-4c43-b190-9c1d4209367f","resolution":{"observed_at":"2026-08-07T13:11:45.926386Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:11:47.495594Z","title":"Rpvnet: A deep and efficient range-point- voxel fusion network for lidar point cloud segmentation,","venue":null,"work_id":"d7418399-ee56-4d9f-8244-a07f867e094b","year":2021},"citing_paper":{"arxiv_id":"2505.22461","last_updated":"2025-05-29T14:45:58Z","snapshot_observed_at":"2026-08-18T01:04:18.961194Z","submitted_at":"2025-05-28T15:16:15Z","title":"SHTOcc: Effective 3D Occupancy Prediction with Sparse Head and Tail Voxels","version":2},"reference_index":54,"source":"pdf_text","source_observed_at":"2026-08-07T13:11:46.033877Z"},"links":{"citing_paper":"/paper/2505.22461"},"observation_digest":"sha256:4613adec65cf5d5906d682bdcdfe3a0c5d91895cfef23cc3be5862141fc5b473","observation_id":"69afb9f8-806a-4c3c-9d53-d4f40ca771eb","resolution":{"observed_at":"2026-08-07T13:11:47.588244Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}}],"paper":{"arxiv_id":"2505.22461","last_updated":"2025-05-29T14:45:58Z","latest_version":2,"primary_category":"cs.CV","snapshot_observed_at":"2026-08-18T01:04:18.961194Z","submitted_at":"2025-05-28T15:16:15Z","title":"SHTOcc: Effective 3D Occupancy Prediction with Sparse Head and Tail Voxels"},"reference_resolution":{"displayed":54,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":27,"verified_exact":5,"verified_fuzzy":22},"total_outbound_references":54},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"thesis":"As of 19 August 2026, this Paper Citation Record lists 54 of 54 outbound references and 1 inbound Pith citation observation for arXiv:2505.22461."}