{"as_of":"2026-08-10T11:54:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:d64ced7089093a2d8ad342ef21b1a50a7efec82842ab4b8e1522b3b01ac46c55","coverage":[{"denominator":0,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":35,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":35,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-10T06:31:04.303077+00:00","state":"measured"},{"denominator":35,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":35,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-07T14:12:10.063951Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":1,"source":"arxiv_reference","source_observed_at":"2026-08-05T02:28:24.338817Z","state":"measured"}],"external_citation_measurements":[{"count":30,"observed_at":"2026-08-05T02:28:24.338817Z","source":"arxiv_reference"}],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2211.10581","last_updated":"2023-02-10T05:47:05Z","snapshot_observed_at":"2026-08-09T18:47:26.148925Z","submitted_at":"2022-11-19T04:20:57Z","title":"Sparse4D: Multi-view 3D Object Detection with Sparse Spatial-Temporal Fusion","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2211.10581","snapshot_observed_at":"2026-08-07T14:12:10.063951Z","title":"Sparse4d: Multi-view 3d object detection with sparse spatial-temporal fusion","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2505.19692","last_updated":"2025-05-26T08:50:15Z","snapshot_observed_at":"2026-08-09T18:47:52.216182Z","submitted_at":"2025-05-26T08:50:15Z","title":"DriveCamSim: Generalizable Camera Simulation via Explicit Camera Modeling for Autonomous Driving","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-07T14:12:10.063951Z"},"links":{"cited_paper":"/paper/2211.10581","citing_paper":"/paper/2505.19692"},"observation_digest":"sha256:a8f6880425efc8fe466feed4dff05e68b95c2ae1958105fe94c6554faece01d4","observation_id":"caad2c65-85f6-4bac-9d1e-fdea446c1587","resolution":{"observed_at":"2026-08-07T14:12:10.063951Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2211.10581","last_updated":"2023-02-10T05:47:05Z","snapshot_observed_at":"2026-08-09T18:47:26.148925Z","submitted_at":"2022-11-19T04:20:57Z","title":"Sparse4D: Multi-view 3D Object Detection with Sparse Spatial-Temporal Fusion","version":2},"cited_work":{"arxiv_id":"2211.10581","doi":"10.48550/arxiv.2211.10581","metadata_source":"arxiv_reference","pith_arxiv_id":"2211.10581","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Sparse4D: Multi-view 3D object detection with sparse spatial-temporal fusion","venue":"arXiv (Cornell University)","work_id":"44ddd7f0-b7cf-4298-a542-5f1c2981d4cd","year":2022},"citing_paper":{"arxiv_id":"2506.07002","last_updated":"2026-04-05T17:55:26Z","snapshot_observed_at":"2026-07-06T21:38:34.998414Z","submitted_at":"2025-06-08T05:19:02Z","title":"BePo: Dual Representation for 3D Occupancy Prediction","version":2},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-05-19T11:30:16.328722Z"},"links":{"cited_paper":"/paper/2211.10581","citing_paper":"/paper/2506.07002"},"observation_digest":"sha256:ab4203f26563e86ff7f1ce8051b42b9a872535d23799a51ed546b81a51b50d45","observation_id":"c8b447e5-ecec-4cf0-af6d-6a0a669ab594","resolution":{"observed_at":"2026-05-19T11:32:17.482712Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2211.10581","last_updated":"2023-02-10T05:47:05Z","snapshot_observed_at":"2026-08-09T18:47:26.148925Z","submitted_at":"2022-11-19T04:20:57Z","title":"Sparse4D: Multi-view 3D Object Detection with Sparse Spatial-Temporal Fusion","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2211.10581","snapshot_observed_at":"2026-08-07T04:53:40.820967Z","title":"Sparse4d: Multi-view 3d object detection with sparse spatial-temporal fusion.arXiv preprint arXiv:2211.10581, 2022","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2506.09417","last_updated":"2025-06-12T13:55:53Z","snapshot_observed_at":"2026-08-08T13:38:36.127007Z","submitted_at":"2025-06-11T06:03:03Z","title":"ODG: Occupancy Prediction Using Dual Gaussians","version":2},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-08-07T04:53:40.820967Z"},"links":{"cited_paper":"/paper/2211.10581","citing_paper":"/paper/2506.09417"},"observation_digest":"sha256:ca8dcb0f266327cfbb52c76773158bc70b3f658d215d4c5849bd221bafde58ab","observation_id":"7c0c6943-9885-4c54-ab2e-7cf52723a020","resolution":{"observed_at":"2026-08-07T04:53:40.820967Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2211.10581","last_updated":"2023-02-10T05:47:05Z","snapshot_observed_at":"2026-08-09T18:47:26.148925Z","submitted_at":"2022-11-19T04:20:57Z","title":"Sparse4D: Multi-view 3D Object Detection with Sparse Spatial-Temporal Fusion","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2211.10581","snapshot_observed_at":"2026-08-07T04:35:23.703406Z","title":"Sparse4d: Multi-view 3d object detec- tion with sparse spatial-temporal fusion","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2506.10242","last_updated":"2025-06-11T23:49:56Z","snapshot_observed_at":"2026-08-09T18:47:50.772403Z","submitted_at":"2025-06-11T23:49:56Z","title":"DySS: Dynamic Queries and State-Space Learning for Efficient 3D Object Detection from Multi-Camera Videos","version":1},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-07T04:35:23.703406Z"},"links":{"cited_paper":"/paper/2211.10581","citing_paper":"/paper/2506.10242"},"observation_digest":"sha256:3cb4210de6ed2362a2efddfd9b5240119bb2704885c38ad17b6f5ce3048e4f1e","observation_id":"6be02f11-7fa4-40b4-ac06-aaf02d211a87","resolution":{"observed_at":"2026-08-07T04:35:23.703406Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2211.10581","last_updated":"2023-02-10T05:47:05Z","snapshot_observed_at":"2026-08-09T18:47:26.148925Z","submitted_at":"2022-11-19T04:20:57Z","title":"Sparse4D: Multi-view 3D Object Detection with Sparse Spatial-Temporal Fusion","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2211.10581","snapshot_observed_at":"2026-08-06T21:42:19.453913Z","title":"Sparse4d: Multi-view 3d object detec- tion with sparse spatial-temporal fusion","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2506.23565","last_updated":"2025-06-30T07:18:17Z","snapshot_observed_at":"2026-08-06T21:35:40.325751Z","submitted_at":"2025-06-30T07:18:17Z","title":"OcRFDet: Object-Centric Radiance Fields for Multi-View 3D Object Detection in Autonomous Driving","version":1},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-08-06T21:42:19.453913Z"},"links":{"cited_paper":"/paper/2211.10581","citing_paper":"/paper/2506.23565"},"observation_digest":"sha256:5ef90df8702589ae808b58089c246176c5c368180e02e29559b3730476b3a6b5","observation_id":"aafc012a-6c9c-42ac-b814-6b89b1e1edb5","resolution":{"observed_at":"2026-08-06T21:42:19.453913Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2211.10581","last_updated":"2023-02-10T05:47:05Z","snapshot_observed_at":"2026-08-09T18:47:26.148925Z","submitted_at":"2022-11-19T04:20:57Z","title":"Sparse4D: Multi-view 3D Object Detection with Sparse Spatial-Temporal Fusion","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2211.10581","snapshot_observed_at":"2026-08-06T21:19:30.259711Z","title":"Sparse4d: Multi-view 3d object detec- tion with sparse spatial-temporal fusion","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2507.00603","last_updated":"2025-07-01T09:36:38Z","snapshot_observed_at":"2026-08-09T10:30:16.515790Z","submitted_at":"2025-07-01T09:36:38Z","title":"World4Drive: End-to-End Autonomous Driving via Intention-aware Physical Latent World Model","version":1},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-06T21:19:30.259711Z"},"links":{"cited_paper":"/paper/2211.10581","citing_paper":"/paper/2507.00603"},"observation_digest":"sha256:ba77d6956191582e991e99ac4ccdca0b20563251a120603531988a9c872d966a","observation_id":"76534d3f-2bfd-4c15-b5aa-f7dac4250ec9","resolution":{"observed_at":"2026-08-06T21:19:30.259711Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2211.10581","last_updated":"2023-02-10T05:47:05Z","snapshot_observed_at":"2026-08-09T18:47:26.148925Z","submitted_at":"2022-11-19T04:20:57Z","title":"Sparse4D: Multi-view 3D Object Detection with Sparse Spatial-Temporal Fusion","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2211.10581","snapshot_observed_at":"2026-08-06T20:57:38.997845Z","title":null,"venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2507.01397","last_updated":"2025-07-28T12:57:34Z","snapshot_observed_at":"2026-08-09T18:47:52.975677Z","submitted_at":"2025-07-02T06:26:17Z","title":"Coherent Online Road Topology Estimation and Reasoning with Standard-Definition Maps","version":2},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-08-06T20:57:38.997845Z"},"links":{"cited_paper":"/paper/2211.10581","citing_paper":"/paper/2507.01397"},"observation_digest":"sha256:848f92c3cc69ac5d23e157e5c5be1464737f92153070ae712cbe2f05398ad458","observation_id":"2a0e437d-f3b9-4262-9c35-8453219f3330","resolution":{"observed_at":"2026-08-06T20:57:38.997845Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2211.10581","last_updated":"2023-02-10T05:47:05Z","snapshot_observed_at":"2026-08-09T18:47:26.148925Z","submitted_at":"2022-11-19T04:20:57Z","title":"Sparse4D: Multi-view 3D Object Detection with Sparse Spatial-Temporal Fusion","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2211.10581","snapshot_observed_at":"2026-08-06T19:32:33.897370Z","title":"Sparse4d: Multi-view 3d object detec- tion with sparse spatial-temporal fusion","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2507.05260","last_updated":"2025-07-07T17:59:58Z","snapshot_observed_at":"2026-08-09T17:02:58.411542Z","submitted_at":"2025-07-07T17:59:58Z","title":"Beyond One Shot, Beyond One Perspective: Cross-View and Long-Horizon Distillation for Better LiDAR Representations","version":1},"reference_index":44,"source":"pdf_text","source_observed_at":"2026-08-06T19:32:33.897370Z"},"links":{"cited_paper":"/paper/2211.10581","citing_paper":"/paper/2507.05260"},"observation_digest":"sha256:1c1f69be976d7e33ff47fe45adeb8715b307e32f66094081d4f16d37f5cf75d6","observation_id":"61f230a0-9411-475a-9baf-c38d144490aa","resolution":{"observed_at":"2026-08-06T19:32:33.897370Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2211.10581","last_updated":"2023-02-10T05:47:05Z","snapshot_observed_at":"2026-08-09T18:47:26.148925Z","submitted_at":"2022-11-19T04:20:57Z","title":"Sparse4D: Multi-view 3D Object Detection with Sparse Spatial-Temporal Fusion","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2211.10581","snapshot_observed_at":"2026-08-06T18:17:13.548914Z","title":"Sparse4d: Multi-view 3d object detection with sparse spatial-temporal fusion,","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2507.08644","last_updated":"2025-07-11T14:48:59Z","snapshot_observed_at":"2026-08-09T15:26:02.631910Z","submitted_at":"2025-07-11T14:48:59Z","title":"OnlineBEV: Recurrent Temporal Fusion in Bird's Eye View Representations for Multi-Camera 3D Perception","version":1},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-06T18:17:13.548914Z"},"links":{"cited_paper":"/paper/2211.10581","citing_paper":"/paper/2507.08644"},"observation_digest":"sha256:8380de5acb827ae8d79127d6411ae052cf794c2c3f124b1345257ebcdbaa62fa","observation_id":"9786eb4d-cc41-404f-95a0-d80181a3cda6","resolution":{"observed_at":"2026-08-06T18:17:13.548914Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2211.10581","last_updated":"2023-02-10T05:47:05Z","snapshot_observed_at":"2026-08-09T18:47:26.148925Z","submitted_at":"2022-11-19T04:20:57Z","title":"Sparse4D: Multi-view 3D Object Detection with Sparse Spatial-Temporal Fusion","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2211.10581","snapshot_observed_at":"2026-08-06T14:48:19.159031Z","title":"Sparse4d: Multi-view 3d object detec- tion with sparse spatial-temporal fusion","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2507.17661","last_updated":"2025-07-23T16:29:45Z","snapshot_observed_at":"2026-08-09T18:47:53.510962Z","submitted_at":"2025-07-23T16:29:45Z","title":"Monocular Semantic Scene Completion via Masked Recurrent Networks","version":1},"reference_index":49,"source":"pdf_text","source_observed_at":"2026-08-06T14:48:19.159031Z"},"links":{"cited_paper":"/paper/2211.10581","citing_paper":"/paper/2507.17661"},"observation_digest":"sha256:c2b4725019384af67d9ce1395d522243166f15d027e8e1463dd8f83bb01885c0","observation_id":"2dd372dd-77ec-49ab-a405-34cc0db63d04","resolution":{"observed_at":"2026-08-06T14:48:19.159031Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2211.10581","last_updated":"2023-02-10T05:47:05Z","snapshot_observed_at":"2026-08-09T18:47:26.148925Z","submitted_at":"2022-11-19T04:20:57Z","title":"Sparse4D: Multi-view 3D Object Detection with Sparse Spatial-Temporal Fusion","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2211.10581","snapshot_observed_at":"2026-08-06T10:42:00.965776Z","title":"Sparse4d: Multi-view 3d object detec- tion with sparse spatial-temporal fusion.arXiv preprint arXiv:2211.10581, 2022","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2507.23567","last_updated":"2025-09-05T15:41:13Z","snapshot_observed_at":"2026-08-08T01:12:00.953493Z","submitted_at":"2025-07-31T13:56:41Z","title":"3D-MOOD: Lifting 2D to 3D for Monocular Open-Set Object Detection","version":2},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-08-06T10:42:00.965776Z"},"links":{"cited_paper":"/paper/2211.10581","citing_paper":"/paper/2507.23567"},"observation_digest":"sha256:8116662d3b2315b1b3b9f0b50934f2b13f2fe8660f42eb6934b66c87bd5c6107","observation_id":"534d9725-5280-45d3-aa1e-69eee1b9382e","resolution":{"observed_at":"2026-08-06T10:42:00.965776Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2211.10581","last_updated":"2023-02-10T05:47:05Z","snapshot_observed_at":"2026-08-09T18:47:26.148925Z","submitted_at":"2022-11-19T04:20:57Z","title":"Sparse4D: Multi-view 3D Object Detection with Sparse Spatial-Temporal Fusion","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2211.10581","snapshot_observed_at":"2026-08-06T10:15:57.161913Z","title":"Sparse4d: Multi-view 3d object detec- tion with sparse spatial-temporal fusion","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2508.00359","last_updated":"2025-08-01T06:45:12Z","snapshot_observed_at":"2026-08-09T18:48:16.814633Z","submitted_at":"2025-08-01T06:45:12Z","title":"CoST: Efficient Collaborative Perception From Unified Spatiotemporal Perspective","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-06T10:15:57.161913Z"},"links":{"cited_paper":"/paper/2211.10581","citing_paper":"/paper/2508.00359"},"observation_digest":"sha256:78e6cbbebd83745904e0ed69313b80a349451873fba48fe5423f403c428a88aa","observation_id":"62927293-775f-4ffb-9136-65bbb4c001b3","resolution":{"observed_at":"2026-08-06T10:15:57.161913Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2211.10581","last_updated":"2023-02-10T05:47:05Z","snapshot_observed_at":"2026-08-09T18:47:26.148925Z","submitted_at":"2022-11-19T04:20:57Z","title":"Sparse4D: Multi-view 3D Object Detection with Sparse Spatial-Temporal Fusion","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2211.10581","snapshot_observed_at":"2026-08-05T23:50:07.394480Z","title":"Sparse4d: Multi-view 3d object detection with sparse spatial-temporal fusion,","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2508.04696","last_updated":"2025-08-06T17:57:58Z","snapshot_observed_at":"2026-08-07T23:22:21.667628Z","submitted_at":"2025-08-06T17:57:58Z","title":"Achieving Precise and Reliable Locomotion with Differentiable Simulation-Based System Identification","version":1},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-05T23:50:07.394480Z"},"links":{"cited_paper":"/paper/2211.10581","citing_paper":"/paper/2508.04696"},"observation_digest":"sha256:e3073053a47ed6c701f4b63326bf59cc4f6d0ecc6ca2710bbd1d828c4950f012","observation_id":"96f70bc3-027e-4821-a9a0-b9a040dadc68","resolution":{"observed_at":"2026-08-05T23:50:07.394480Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2211.10581","last_updated":"2023-02-10T05:47:05Z","snapshot_observed_at":"2026-08-09T18:47:26.148925Z","submitted_at":"2022-11-19T04:20:57Z","title":"Sparse4D: Multi-view 3D Object Detection with Sparse Spatial-Temporal Fusion","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2211.10581","snapshot_observed_at":"2026-08-05T23:53:11.647043Z","title":"Sparse4d: Multi-view 3d object detection with sparse spatial-temporal fusion,","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2508.04702","last_updated":"2025-08-06T17:59:37Z","snapshot_observed_at":"2026-08-08T12:41:28.737292Z","submitted_at":"2025-08-06T17:59:37Z","title":"BEVCon: Advancing Bird's Eye View Perception with Contrastive Learning","version":1},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-05T23:53:11.647043Z"},"links":{"cited_paper":"/paper/2211.10581","citing_paper":"/paper/2508.04702"},"observation_digest":"sha256:c17ec50f365785d05bf53fb271881a734587642077b02c12c98de09a03180aaf","observation_id":"3be86adc-6957-4195-83b5-20d95ed93dbd","resolution":{"observed_at":"2026-08-05T23:53:11.647043Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2211.10581","last_updated":"2023-02-10T05:47:05Z","snapshot_observed_at":"2026-08-09T18:47:26.148925Z","submitted_at":"2022-11-19T04:20:57Z","title":"Sparse4D: Multi-view 3D Object Detection with Sparse Spatial-Temporal Fusion","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2211.10581","snapshot_observed_at":"2026-08-05T23:51:19.799531Z","title":"Sparse4d: Multi-view 3d object detection with sparse spatial-temporal fusion","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2508.04705","last_updated":"2025-08-06T17:59:52Z","snapshot_observed_at":"2026-08-09T19:37:22.060965Z","submitted_at":"2025-08-06T17:59:52Z","title":"Occupancy Learning with Spatiotemporal Memory","version":1},"reference_index":20,"source":"arxiv_source","source_observed_at":"2026-08-05T23:51:19.799531Z"},"links":{"cited_paper":"/paper/2211.10581","citing_paper":"/paper/2508.04705"},"observation_digest":"sha256:f62a464d42fa499221663af976282d0d68f583d2bf6ef7b6bbee8f265ebe1b52","observation_id":"cd52c2aa-ee73-409f-bdf7-85f4638a0196","resolution":{"observed_at":"2026-08-05T23:51:19.799531Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2211.10581","last_updated":"2023-02-10T05:47:05Z","snapshot_observed_at":"2026-08-09T18:47:26.148925Z","submitted_at":"2022-11-19T04:20:57Z","title":"Sparse4D: Multi-view 3D Object Detection with Sparse Spatial-Temporal Fusion","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2211.10581","snapshot_observed_at":"2026-08-05T23:26:44.230034Z","title":"Sparse4d: Multi-view 3d object detec- tion with sparse spatial-temporal fusion","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2508.05402","last_updated":"2025-08-07T13:54:35Z","snapshot_observed_at":"2026-08-09T18:48:17.406231Z","submitted_at":"2025-08-07T13:54:35Z","title":"DistillDrive: End-to-End Multi-Mode Autonomous Driving Distillation by Isomorphic Hetero-Source Planning Model","version":1},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-08-05T23:26:44.230034Z"},"links":{"cited_paper":"/paper/2211.10581","citing_paper":"/paper/2508.05402"},"observation_digest":"sha256:9e0fe36f192faff6125ca672f9a4416e74ba3ac6e99f2d3b3c94944b2c9edbd6","observation_id":"4ed98399-edad-4706-bfcf-982c23df6aba","resolution":{"observed_at":"2026-08-05T23:26:44.230034Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2211.10581","last_updated":"2023-02-10T05:47:05Z","snapshot_observed_at":"2026-08-09T18:47:26.148925Z","submitted_at":"2022-11-19T04:20:57Z","title":"Sparse4D: Multi-view 3D Object Detection with Sparse Spatial-Temporal Fusion","version":2},"cited_work":{"arxiv_id":"2211.10581","doi":"10.48550/arxiv.2211.10581","metadata_source":"arxiv_reference","pith_arxiv_id":"2211.10581","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Sparse4D: Multi-view 3D object detection with sparse spatial-temporal fusion","venue":"arXiv (Cornell University)","work_id":"44ddd7f0-b7cf-4298-a542-5f1c2981d4cd","year":2022},"citing_paper":{"arxiv_id":"2511.22039","last_updated":"2026-04-14T12:13:24Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-11-27T02:48:45Z","title":"SparseWorld-TC: Trajectory-Conditioned Sparse Occupancy World Model","version":3},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-05-17T05:26:34.859975Z"},"links":{"cited_paper":"/paper/2211.10581","citing_paper":"/paper/2511.22039"},"observation_digest":"sha256:981c1e3cefa7133d555da18d4df3ae4cb8a58676b2bd651ab495e86df8e06cd8","observation_id":"de3b3e95-adab-4aa8-ad54-cdac000e2bd2","resolution":{"observed_at":"2026-05-17T05:29:04.972209Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2211.10581","last_updated":"2023-02-10T05:47:05Z","snapshot_observed_at":"2026-08-09T18:47:26.148925Z","submitted_at":"2022-11-19T04:20:57Z","title":"Sparse4D: Multi-view 3D Object Detection with Sparse Spatial-Temporal Fusion","version":2},"cited_work":{"arxiv_id":"2211.10581","doi":"10.48550/arxiv.2211.10581","metadata_source":"arxiv_reference","pith_arxiv_id":"2211.10581","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Sparse4D: Multi-view 3D object detection with sparse spatial-temporal fusion","venue":"arXiv (Cornell University)","work_id":"44ddd7f0-b7cf-4298-a542-5f1c2981d4cd","year":2022},"citing_paper":{"arxiv_id":"2512.06838","last_updated":"2025-12-07T13:22:06Z","snapshot_observed_at":"2026-07-06T22:37:59.340166Z","submitted_at":"2025-12-07T13:22:06Z","title":"SparseCoop: Cooperative Perception with Kinematic-Grounded Queries","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-05-17T00:28:31.186458Z"},"links":{"cited_paper":"/paper/2211.10581","citing_paper":"/paper/2512.06838"},"observation_digest":"sha256:cd2f038500e900c5e054a0b960e733506e1d2b541512a6abc22b716301dccee1","observation_id":"6681cadb-dd19-463a-a6fa-58c11966bfe4","resolution":{"observed_at":"2026-05-17T00:28:44.681165Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2211.10581","last_updated":"2023-02-10T05:47:05Z","snapshot_observed_at":"2026-08-09T18:47:26.148925Z","submitted_at":"2022-11-19T04:20:57Z","title":"Sparse4D: Multi-view 3D Object Detection with Sparse Spatial-Temporal Fusion","version":2},"cited_work":{"arxiv_id":"2211.10581","doi":"10.48550/arxiv.2211.10581","metadata_source":"arxiv_reference","pith_arxiv_id":"2211.10581","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Sparse4D: Multi-view 3D object detection with sparse spatial-temporal fusion","venue":"arXiv (Cornell University)","work_id":"44ddd7f0-b7cf-4298-a542-5f1c2981d4cd","year":2022},"citing_paper":{"arxiv_id":"2601.01762","last_updated":"2026-06-16T06:55:19Z","snapshot_observed_at":"2026-08-07T10:50:29.315801Z","submitted_at":"2026-01-05T03:41:20Z","title":"AlignDrive: Aligned Lateral-Longitudinal Planning for End-to-End Autonomous Driving","version":2},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-05-16T18:39:49.416119Z"},"links":{"cited_paper":"/paper/2211.10581","citing_paper":"/paper/2601.01762"},"observation_digest":"sha256:96b4f2430496351bffee2474961f36501cb16e96be1c2bcb9a32f75fe9287abf","observation_id":"ff7fee24-e3bc-4574-bab9-1e32901973f2","resolution":{"observed_at":"2026-05-16T18:41:11.151641Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2211.10581","last_updated":"2023-02-10T05:47:05Z","snapshot_observed_at":"2026-08-09T18:47:26.148925Z","submitted_at":"2022-11-19T04:20:57Z","title":"Sparse4D: Multi-view 3D Object Detection with Sparse Spatial-Temporal Fusion","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2211.10581","snapshot_observed_at":"2026-08-03T12:48:35.490310Z","title":"Is ego status all you need for open-loop end-to-end autonomous driving? InProceedings of the IEEE/CVF Conference on Computer Vision and Pattern Recognition, pp","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2601.01762","last_updated":"2026-06-16T06:55:19Z","snapshot_observed_at":"2026-08-07T10:50:29.315801Z","submitted_at":"2026-01-05T03:41:20Z","title":"AlignDrive: Aligned Lateral-Longitudinal Planning for End-to-End Autonomous Driving","version":3},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-03T12:48:35.490310Z"},"links":{"cited_paper":"/paper/2211.10581","citing_paper":"/paper/2601.01762"},"observation_digest":"sha256:3763b562c963a0d405fc94be6a926411fe6e96aa55e70a62cf7ee1f748a9046d","observation_id":"6c76b12c-9625-40cf-9c33-fe34c032eedc","resolution":{"observed_at":"2026-08-03T12:48:35.490310Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2211.10581","last_updated":"2023-02-10T05:47:05Z","snapshot_observed_at":"2026-08-09T18:47:26.148925Z","submitted_at":"2022-11-19T04:20:57Z","title":"Sparse4D: Multi-view 3D Object Detection with Sparse Spatial-Temporal Fusion","version":2},"cited_work":{"arxiv_id":"2211.10581","doi":"10.48550/arxiv.2211.10581","metadata_source":"arxiv_reference","pith_arxiv_id":"2211.10581","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Sparse4D: Multi-view 3D object detection with sparse spatial-temporal fusion","venue":"arXiv (Cornell University)","work_id":"44ddd7f0-b7cf-4298-a542-5f1c2981d4cd","year":2022},"citing_paper":{"arxiv_id":"2604.00813","last_updated":"2026-04-24T15:37:17Z","snapshot_observed_at":"2026-07-06T22:51:26.754746Z","submitted_at":"2026-04-01T12:21:26Z","title":"DVGT-2: Vision-Geometry-Action Model for Autonomous Driving at Scale","version":3},"reference_index":43,"source":"pdf_text","source_observed_at":"2026-05-13T22:59:57.744015Z"},"links":{"cited_paper":"/paper/2211.10581","citing_paper":"/paper/2604.00813"},"observation_digest":"sha256:c4609949059f03acec84da5b5bc62c6d536c72ff76d13c93430cf7a6ab350491","observation_id":"5e3fa24f-662c-455f-9132-0792f1a7ecb6","resolution":{"observed_at":"2026-05-13T23:03:25.186832Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2211.10581","last_updated":"2023-02-10T05:47:05Z","snapshot_observed_at":"2026-08-09T18:47:26.148925Z","submitted_at":"2022-11-19T04:20:57Z","title":"Sparse4D: Multi-view 3D Object Detection with Sparse Spatial-Temporal Fusion","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2211.10581","snapshot_observed_at":"2026-07-15T11:39:16.503017Z","title":"CoRRabs/2211.10581(2022),�������� ���������������������������������","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2604.05447","last_updated":"2026-07-14T14:29:09Z","snapshot_observed_at":"2026-08-02T21:17:28.989539Z","submitted_at":"2026-04-07T05:31:51Z","title":"Kerr-Schild Double Copy of the Randall-Sundrum Black String","version":2},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-07-15T11:39:16.503017Z"},"links":{"cited_paper":"/paper/2211.10581","citing_paper":"/paper/2604.05447"},"observation_digest":"sha256:6810b2cff62e158c842bfbe7bfe1707c9267bac49367f95300ad378f44370db7","observation_id":"29787a8e-5489-4862-b0ec-856e0156e945","resolution":{"observed_at":"2026-07-15T11:39:16.503017Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2211.10581","last_updated":"2023-02-10T05:47:05Z","snapshot_observed_at":"2026-08-09T18:47:26.148925Z","submitted_at":"2022-11-19T04:20:57Z","title":"Sparse4D: Multi-view 3D Object Detection with Sparse Spatial-Temporal Fusion","version":2},"cited_work":{"arxiv_id":"2211.10581","doi":"10.48550/arxiv.2211.10581","metadata_source":"arxiv_reference","pith_arxiv_id":"2211.10581","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Sparse4D: Multi-view 3D object detection with sparse spatial-temporal fusion","venue":"arXiv (Cornell University)","work_id":"44ddd7f0-b7cf-4298-a542-5f1c2981d4cd","year":2022},"citing_paper":{"arxiv_id":"2604.05449","last_updated":"2026-04-07T05:33:54Z","snapshot_observed_at":"2026-08-02T13:37:32.642986Z","submitted_at":"2026-04-07T05:33:54Z","title":"Not All Agents Matter: From Global Attention Dilution to Risk-Prioritized Game Planning","version":1},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-05-10T18:50:48.512471Z"},"links":{"cited_paper":"/paper/2211.10581","citing_paper":"/paper/2604.05449"},"observation_digest":"sha256:87199af7315bacba054f5191130269456ba0071a4ea13f58d6499480c2ef82e1","observation_id":"b8e1d8c8-9c7d-4c51-85b7-f8046af77dff","resolution":{"observed_at":"2026-05-10T20:00:46.394838Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2211.10581","last_updated":"2023-02-10T05:47:05Z","snapshot_observed_at":"2026-08-09T18:47:26.148925Z","submitted_at":"2022-11-19T04:20:57Z","title":"Sparse4D: Multi-view 3D Object Detection with Sparse Spatial-Temporal Fusion","version":2},"cited_work":{"arxiv_id":"2211.10581","doi":"10.48550/arxiv.2211.10581","metadata_source":"arxiv_reference","pith_arxiv_id":"2211.10581","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Sparse4D: Multi-view 3D object detection with sparse spatial-temporal fusion","venue":"arXiv (Cornell University)","work_id":"44ddd7f0-b7cf-4298-a542-5f1c2981d4cd","year":2022},"citing_paper":{"arxiv_id":"2604.13586","last_updated":"2026-04-15T07:44:01Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2026-04-15T07:44:01Z","title":"Efficient Multi-View 3D Object Detection by Dynamic Token Selection and Fine-Tuning","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-05-10T13:35:18.317235Z"},"links":{"cited_paper":"/paper/2211.10581","citing_paper":"/paper/2604.13586"},"observation_digest":"sha256:4aca788523e184bf3763b0d5f660f427a611cb84caa96c49766e13b20340816a","observation_id":"9973b243-f541-4189-a2b5-0ce6b9507f60","resolution":{"observed_at":"2026-05-10T13:35:26.163159Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2211.10581","last_updated":"2023-02-10T05:47:05Z","snapshot_observed_at":"2026-08-09T18:47:26.148925Z","submitted_at":"2022-11-19T04:20:57Z","title":"Sparse4D: Multi-view 3D Object Detection with Sparse Spatial-Temporal Fusion","version":2},"cited_work":{"arxiv_id":"2211.10581","doi":"10.48550/arxiv.2211.10581","metadata_source":"arxiv_reference","pith_arxiv_id":"2211.10581","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Sparse4D: Multi-view 3D object detection with sparse spatial-temporal fusion","venue":"arXiv (Cornell University)","work_id":"44ddd7f0-b7cf-4298-a542-5f1c2981d4cd","year":2022},"citing_paper":{"arxiv_id":"2604.14563","last_updated":"2026-04-16T02:46:53Z","snapshot_observed_at":"2026-07-06T23:02:18.425249Z","submitted_at":"2026-04-16T02:46:53Z","title":"Revisiting Token Compression for Accelerating ViT-based Sparse Multi-View 3D Object Detectors","version":1},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-05-10T11:31:52.126027Z"},"links":{"cited_paper":"/paper/2211.10581","citing_paper":"/paper/2604.14563"},"observation_digest":"sha256:0f203b71edcc0320334018d5715cad05f0d7b840cc271d0b4af2d97ecc1527b5","observation_id":"4c9715a1-f6e6-44af-ad6f-3caf0dff36a2","resolution":{"observed_at":"2026-05-10T11:35:18.951421Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2211.10581","last_updated":"2023-02-10T05:47:05Z","snapshot_observed_at":"2026-08-09T18:47:26.148925Z","submitted_at":"2022-11-19T04:20:57Z","title":"Sparse4D: Multi-view 3D Object Detection with Sparse Spatial-Temporal Fusion","version":2},"cited_work":{"arxiv_id":"2211.10581","doi":"10.48550/arxiv.2211.10581","metadata_source":"arxiv_reference","pith_arxiv_id":"2211.10581","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Sparse4D: Multi-view 3D object detection with sparse spatial-temporal fusion","venue":"arXiv (Cornell University)","work_id":"44ddd7f0-b7cf-4298-a542-5f1c2981d4cd","year":2022},"citing_paper":{"arxiv_id":"2604.17024","last_updated":"2026-04-18T15:14:11Z","snapshot_observed_at":"2026-08-02T11:14:25.634881Z","submitted_at":"2026-04-18T15:14:11Z","title":"CAM3DNet: Comprehensively mining the multi-scale features for 3D Object Detection with Multi-View Cameras","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-05-10T07:16:33.640040Z"},"links":{"cited_paper":"/paper/2211.10581","citing_paper":"/paper/2604.17024"},"observation_digest":"sha256:5ec114faa9fa3b047827b979209d02576ff917828ae914e8aaa954d2f42be34e","observation_id":"00cd3527-241a-4e7d-b60c-8fe1093914eb","resolution":{"observed_at":"2026-05-10T07:16:54.742744Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2211.10581","last_updated":"2023-02-10T05:47:05Z","snapshot_observed_at":"2026-08-09T18:47:26.148925Z","submitted_at":"2022-11-19T04:20:57Z","title":"Sparse4D: Multi-view 3D Object Detection with Sparse Spatial-Temporal Fusion","version":2},"cited_work":{"arxiv_id":"2211.10581","doi":"10.48550/arxiv.2211.10581","metadata_source":"arxiv_reference","pith_arxiv_id":"2211.10581","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Sparse4D: Multi-view 3D object detection with sparse spatial-temporal fusion","venue":"arXiv (Cornell University)","work_id":"44ddd7f0-b7cf-4298-a542-5f1c2981d4cd","year":2022},"citing_paper":{"arxiv_id":"2604.18476","last_updated":"2026-04-20T16:28:01Z","snapshot_observed_at":"2026-08-03T00:20:08.083629Z","submitted_at":"2026-04-20T16:28:01Z","title":"SemLT3D: Semantic-Guided Expert Distillation for Camera-only Long-Tailed 3D Object Detection","version":1},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-05-10T05:53:11.157832Z"},"links":{"cited_paper":"/paper/2211.10581","citing_paper":"/paper/2604.18476"},"observation_digest":"sha256:b8f25825fb3e17127121407334748438302e9c8555d06e59d8033607e258f32f","observation_id":"4454cc97-b4cc-4985-ac3b-8ddb83eb9b7e","resolution":{"observed_at":"2026-05-10T05:56:11.195000Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2211.10581","last_updated":"2023-02-10T05:47:05Z","snapshot_observed_at":"2026-08-09T18:47:26.148925Z","submitted_at":"2022-11-19T04:20:57Z","title":"Sparse4D: Multi-view 3D Object Detection with Sparse Spatial-Temporal Fusion","version":2},"cited_work":{"arxiv_id":"2211.10581","doi":"10.48550/arxiv.2211.10581","metadata_source":"arxiv_reference","pith_arxiv_id":"2211.10581","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Sparse4D: Multi-view 3D object detection with sparse spatial-temporal fusion","venue":"arXiv (Cornell University)","work_id":"44ddd7f0-b7cf-4298-a542-5f1c2981d4cd","year":2022},"citing_paper":{"arxiv_id":"2605.01924","last_updated":"2026-05-03T15:10:38Z","snapshot_observed_at":"2026-07-06T23:15:07.159340Z","submitted_at":"2026-05-03T15:10:38Z","title":"SimPB++: Simultaneously Detecting 2D and 3D Objects from Multiple Cameras","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-05-09T17:22:01.467937Z"},"links":{"cited_paper":"/paper/2211.10581","citing_paper":"/paper/2605.01924"},"observation_digest":"sha256:659d17e9ce4e4d9229873c0327daa87c997dc22dcd5d3d67c36ddda24361670c","observation_id":"26d31e85-b7b9-48db-b9c7-9d01cc062bf4","resolution":{"observed_at":"2026-05-11T16:21:07.770349Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2211.10581","last_updated":"2023-02-10T05:47:05Z","snapshot_observed_at":"2026-08-09T18:47:26.148925Z","submitted_at":"2022-11-19T04:20:57Z","title":"Sparse4D: Multi-view 3D Object Detection with Sparse Spatial-Temporal Fusion","version":2},"cited_work":{"arxiv_id":"2211.10581","doi":"10.48550/arxiv.2211.10581","metadata_source":"arxiv_reference","pith_arxiv_id":"2211.10581","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Sparse4D: Multi-view 3D object detection with sparse spatial-temporal fusion","venue":"arXiv (Cornell University)","work_id":"44ddd7f0-b7cf-4298-a542-5f1c2981d4cd","year":2022},"citing_paper":{"arxiv_id":"2605.11594","last_updated":"2026-05-12T06:20:59Z","snapshot_observed_at":"2026-08-08T17:38:06.227372Z","submitted_at":"2026-05-12T06:20:59Z","title":"PointForward: Feedforward Driving Reconstruction through Point-Aligned Representations","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-05-13T01:22:05.111224Z"},"links":{"cited_paper":"/paper/2211.10581","citing_paper":"/paper/2605.11594"},"observation_digest":"sha256:a67e5301c9b86e8cb13d62e7d0f7acd6d08b4f909f3a70874f538c89e5755aeb","observation_id":"f10b4701-0645-4bab-a0f0-ad62b6f17d65","resolution":{"observed_at":"2026-05-13T01:27:02.681999Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2211.10581","last_updated":"2023-02-10T05:47:05Z","snapshot_observed_at":"2026-08-09T18:47:26.148925Z","submitted_at":"2022-11-19T04:20:57Z","title":"Sparse4D: Multi-view 3D Object Detection with Sparse Spatial-Temporal Fusion","version":2},"cited_work":{"arxiv_id":"2211.10581","doi":"10.48550/arxiv.2211.10581","metadata_source":"arxiv_reference","pith_arxiv_id":"2211.10581","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Sparse4D: Multi-view 3D object detection with sparse spatial-temporal fusion","venue":"arXiv (Cornell University)","work_id":"44ddd7f0-b7cf-4298-a542-5f1c2981d4cd","year":2022},"citing_paper":{"arxiv_id":"2605.16911","last_updated":"2026-05-16T09:51:04Z","snapshot_observed_at":"2026-07-06T23:27:57.805018Z","submitted_at":"2026-05-16T09:51:04Z","title":"VGGT-Occ: Geometry-Grounded and Density-Aware Gated Fusion for 3D Occupancy Prediction","version":1},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-05-19T21:19:17.894557Z"},"links":{"cited_paper":"/paper/2211.10581","citing_paper":"/paper/2605.16911"},"observation_digest":"sha256:1d113bf52455609df102c275f4ca551fecf0e7f33b99ae651258630586520ef3","observation_id":"b4ffba30-365c-430e-9bfc-a74e08b413df","resolution":{"observed_at":"2026-05-19T21:22:48.050739Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2211.10581","last_updated":"2023-02-10T05:47:05Z","snapshot_observed_at":"2026-08-09T18:47:26.148925Z","submitted_at":"2022-11-19T04:20:57Z","title":"Sparse4D: Multi-view 3D Object Detection with Sparse Spatial-Temporal Fusion","version":2},"cited_work":{"arxiv_id":"2211.10581","doi":"10.48550/arxiv.2211.10581","metadata_source":"arxiv_reference","pith_arxiv_id":"2211.10581","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Sparse4D: Multi-view 3D object detection with sparse spatial-temporal fusion","venue":"arXiv (Cornell University)","work_id":"44ddd7f0-b7cf-4298-a542-5f1c2981d4cd","year":2022},"citing_paper":{"arxiv_id":"2605.30307","last_updated":"2026-05-28T17:51:38Z","snapshot_observed_at":"2026-08-02T22:39:52.853482Z","submitted_at":"2026-05-28T17:51:38Z","title":"Grounded 3D-Aware Spatial Vision-Language Modeling","version":1},"reference_index":89,"source":"pdf_text","source_observed_at":"2026-06-29T08:08:36.012761Z"},"links":{"cited_paper":"/paper/2211.10581","citing_paper":"/paper/2605.30307"},"observation_digest":"sha256:460da15cfc28b4888994b4f8a231ae492fc4592fb21e82ee1c88010021a5bc8c","observation_id":"7a862818-12c8-42b0-adb5-184ae6fd829b","resolution":{"observed_at":"2026-06-29T08:13:15.330446Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2211.10581","last_updated":"2023-02-10T05:47:05Z","snapshot_observed_at":"2026-08-09T18:47:26.148925Z","submitted_at":"2022-11-19T04:20:57Z","title":"Sparse4D: Multi-view 3D Object Detection with Sparse Spatial-Temporal Fusion","version":2},"cited_work":{"arxiv_id":"2211.10581","doi":"10.48550/arxiv.2211.10581","metadata_source":"arxiv_reference","pith_arxiv_id":"2211.10581","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Sparse4D: Multi-view 3D object detection with sparse spatial-temporal fusion","venue":"arXiv (Cornell University)","work_id":"44ddd7f0-b7cf-4298-a542-5f1c2981d4cd","year":2022},"citing_paper":{"arxiv_id":"2605.30983","last_updated":"2026-05-29T08:18:44Z","snapshot_observed_at":"2026-08-03T07:34:39.547714Z","submitted_at":"2026-05-29T08:18:44Z","title":"Can BEV Perception Gracefully Degrade under Sensor Failures?","version":1},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-06-28T22:56:38.949269Z"},"links":{"cited_paper":"/paper/2211.10581","citing_paper":"/paper/2605.30983"},"observation_digest":"sha256:2e04b268743a54e11eb10df018344b08d50a8e86451ccefd8fec095de881c46e","observation_id":"b799f7e1-8fa0-4b3a-a272-62aa5a0a3ab1","resolution":{"observed_at":"2026-06-28T23:02:46.952347Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2211.10581","last_updated":"2023-02-10T05:47:05Z","snapshot_observed_at":"2026-08-09T18:47:26.148925Z","submitted_at":"2022-11-19T04:20:57Z","title":"Sparse4D: Multi-view 3D Object Detection with Sparse Spatial-Temporal Fusion","version":2},"cited_work":{"arxiv_id":"2211.10581","doi":"10.48550/arxiv.2211.10581","metadata_source":"arxiv_reference","pith_arxiv_id":"2211.10581","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Sparse4D: Multi-view 3D object detection with sparse spatial-temporal fusion","venue":"arXiv (Cornell University)","work_id":"44ddd7f0-b7cf-4298-a542-5f1c2981d4cd","year":2022},"citing_paper":{"arxiv_id":"2606.12396","last_updated":"2026-06-10T17:57:06Z","snapshot_observed_at":"2026-07-06T23:51:17.719874Z","submitted_at":"2026-06-10T17:57:06Z","title":"VLGA: Vision-Language-Geometry-Action Models for Autonomous Driving","version":1},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-06-27T09:40:51.407286Z"},"links":{"cited_paper":"/paper/2211.10581","citing_paper":"/paper/2606.12396"},"observation_digest":"sha256:af79ab696f883e816afa4cc93911b609dcba1ada92bc835a381e7ba794835413","observation_id":"f63e57b2-601c-4692-8b53-939a903aac68","resolution":{"observed_at":"2026-07-03T11:08:03.433200Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2211.10581","last_updated":"2023-02-10T05:47:05Z","snapshot_observed_at":"2026-08-09T18:47:26.148925Z","submitted_at":"2022-11-19T04:20:57Z","title":"Sparse4D: Multi-view 3D Object Detection with Sparse Spatial-Temporal Fusion","version":2},"cited_work":{"arxiv_id":"2211.10581","doi":"10.48550/arxiv.2211.10581","metadata_source":"arxiv_reference","pith_arxiv_id":"2211.10581","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Sparse4D: Multi-view 3D object detection with sparse spatial-temporal fusion","venue":"arXiv (Cornell University)","work_id":"44ddd7f0-b7cf-4298-a542-5f1c2981d4cd","year":2022},"citing_paper":{"arxiv_id":"2606.25736","last_updated":"2026-06-24T12:03:54Z","snapshot_observed_at":"2026-08-08T11:59:14.055897Z","submitted_at":"2026-06-24T12:03:54Z","title":"UniTeD: Unified Temporal Diffusion for Joint Perception and Planning in Autonomous Driving","version":1},"reference_index":39,"source":"pdf_text","source_observed_at":"2026-06-25T21:12:59.598842Z"},"links":{"cited_paper":"/paper/2211.10581","citing_paper":"/paper/2606.25736"},"observation_digest":"sha256:eb1f36964bdc84ba972b3fa7d6c81b75e3ff120e9faf59f052eca291d8827d47","observation_id":"e299f2d5-2fbc-4b56-aa65-40f92e64929e","resolution":{"observed_at":"2026-07-04T19:30:08.081546Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2211.10581","last_updated":"2023-02-10T05:47:05Z","snapshot_observed_at":"2026-08-09T18:47:26.148925Z","submitted_at":"2022-11-19T04:20:57Z","title":"Sparse4D: Multi-view 3D Object Detection with Sparse Spatial-Temporal Fusion","version":2},"cited_work":{"arxiv_id":"2211.10581","doi":"10.48550/arxiv.2211.10581","metadata_source":"arxiv_reference","pith_arxiv_id":"2211.10581","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Sparse4D: Multi-view 3D object detection with sparse spatial-temporal fusion","venue":"arXiv (Cornell University)","work_id":"44ddd7f0-b7cf-4298-a542-5f1c2981d4cd","year":2022},"citing_paper":{"arxiv_id":"2606.30754","last_updated":"2026-06-29T18:00:42Z","snapshot_observed_at":"2026-08-02T04:01:57.680474Z","submitted_at":"2026-06-29T18:00:42Z","title":"Streaming Gaussian Encoding for 4D Panoptic Occupancy Tracking","version":1},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-07-01T06:28:47.232989Z"},"links":{"cited_paper":"/paper/2211.10581","citing_paper":"/paper/2606.30754"},"observation_digest":"sha256:b25d220a81c47191791b83f1bb4ee9b0ab0efca104bd2347b1f5a20a7690ba6e","observation_id":"dc465aec-17f7-4849-ad76-891a0bc7d093","resolution":{"observed_at":"2026-07-01T09:35:39.853979Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}}],"links":{"evidence":"/evidence","html":"/paper/2211.10581/citation-record","integrity":"/paper/2211.10581/integrity","json":"/paper/2211.10581/citation-record.json","paper":"/paper/2211.10581"},"outbound":[],"paper":{"arxiv_id":"2211.10581","last_updated":"2023-02-10T05:47:05Z","latest_version":2,"primary_category":"cs.CV","snapshot_observed_at":"2026-08-09T18:47:26.148925Z","submitted_at":"2022-11-19T04:20:57Z","title":"Sparse4D: Multi-view 3D Object Detection with Sparse Spatial-Temporal Fusion"},"reference_resolution":{"displayed":0,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":0,"verified_exact":0,"verified_fuzzy":0},"total_outbound_references":0},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"thesis":"As of 10 August 2026, this Paper Citation Record lists 0 of 0 outbound references and 35 inbound Pith citation observations for arXiv:2211.10581."}