{"as_of":"2026-08-10T19:08:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:d039ab095a93953b0bcaffca5aab4a5155538eecc4e099a64821c74f2036797a","coverage":[{"denominator":0,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":8,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":8,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-10T06:31:04.303077+00:00","state":"measured"},{"denominator":8,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":8,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-09T14:07:27.658400Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"arxiv_reference","source_observed_at":"2026-07-01T15:05:47.851672Z","state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2303.17099","last_updated":"2023-03-30T02:18:07Z","snapshot_observed_at":"2026-08-09T20:13:34.136612Z","submitted_at":"2023-03-30T02:18:07Z","title":"BEVFusion4D: Learning LiDAR-Camera Fusion Under Bird's-Eye-View via Cross-Modality Guidance and Temporal Aggregation","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2303.17099","snapshot_observed_at":"2026-08-09T14:07:27.658400Z","title":"BEVFusion4D: Learn- ing lidar-camera fusion under bird’s-eye view via cross- modality guidance and temporal aggregation","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2502.01894","last_updated":"2025-03-26T20:42:44Z","snapshot_observed_at":"2026-08-10T10:17:48.054722Z","submitted_at":"2025-02-04T00:00:06Z","title":"SimBEV: A Synthetic Multi-Task Multi-Sensor Driving Data Generation Tool and Dataset","version":2},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-09T14:07:27.658400Z"},"links":{"cited_paper":"/paper/2303.17099","citing_paper":"/paper/2502.01894"},"observation_digest":"sha256:bd0ee8fce0f8fed213a68fcdb462e33f9bedb1dc0729d63ecbc605c60d529043","observation_id":"d30e14f6-d001-409d-aec9-48ce86f55e9b","resolution":{"observed_at":"2026-08-09T14:07:27.658400Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2303.17099","last_updated":"2023-03-30T02:18:07Z","snapshot_observed_at":"2026-08-09T20:13:34.136612Z","submitted_at":"2023-03-30T02:18:07Z","title":"BEVFusion4D: Learning LiDAR-Camera Fusion Under Bird's-Eye-View via Cross-Modality Guidance and Temporal Aggregation","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2303.17099","snapshot_observed_at":"2026-08-05T22:06:55.324415Z","title":"arXiv preprint arXiv:2303.17099 (2023)","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2508.07560","last_updated":"2025-08-11T02:40:46Z","snapshot_observed_at":"2026-08-07T04:31:51.628723Z","submitted_at":"2025-08-11T02:40:46Z","title":"Progressive Bird's Eye View Perception for Safety-Critical Autonomous Driving: A Comprehensive Survey","version":1},"reference_index":165,"source":"pdf_text","source_observed_at":"2026-08-05T22:06:55.324415Z"},"links":{"cited_paper":"/paper/2303.17099","citing_paper":"/paper/2508.07560"},"observation_digest":"sha256:9fdd223d512cabad785ca40690d1f2372a5f89702076d46c1827031ab4fafbeb","observation_id":"863cde2f-d73c-4538-94b1-5183712bf0e9","resolution":{"observed_at":"2026-08-05T22:06:55.324415Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2303.17099","last_updated":"2023-03-30T02:18:07Z","snapshot_observed_at":"2026-08-09T20:13:34.136612Z","submitted_at":"2023-03-30T02:18:07Z","title":"BEVFusion4D: Learning LiDAR-Camera Fusion Under Bird's-Eye-View via Cross-Modality Guidance and Temporal Aggregation","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2303.17099","snapshot_observed_at":"2026-08-05T18:52:25.144131Z","title":"Bevfusion4d: Learn- ing lidar-camera fusion under bird’s-eye-view via cross- modality guidance and temporal aggregation","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2508.13995","last_updated":"2025-08-19T16:40:29Z","snapshot_observed_at":"2026-08-08T08:06:45.393924Z","submitted_at":"2025-08-19T16:40:29Z","title":"Self-Supervised Sparse Sensor Fusion for Long Range Perception","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-05T18:52:25.144131Z"},"links":{"cited_paper":"/paper/2303.17099","citing_paper":"/paper/2508.13995"},"observation_digest":"sha256:bcb21bd0f2c470a352132c57db571b73461faf0ef1f2643581cdec56a5dcdbb3","observation_id":"440ee4ea-6653-4886-897c-65094a7938e8","resolution":{"observed_at":"2026-08-05T18:52:25.144131Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2303.17099","last_updated":"2023-03-30T02:18:07Z","snapshot_observed_at":"2026-08-09T20:13:34.136612Z","submitted_at":"2023-03-30T02:18:07Z","title":"BEVFusion4D: Learning LiDAR-Camera Fusion Under Bird's-Eye-View via Cross-Modality Guidance and Temporal Aggregation","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2303.17099","snapshot_observed_at":"2026-08-05T17:21:44.599018Z","title":"arXiv preprint arXiv:2303.17099 (2023) 4","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2508.16408","last_updated":"2025-08-22T14:20:46Z","snapshot_observed_at":"2026-08-05T17:21:43.445017Z","submitted_at":"2025-08-22T14:20:46Z","title":"SAMFusion: Sensor-Adaptive Multimodal Fusion for 3D Object Detection in Adverse Weather","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-05T17:21:44.599018Z"},"links":{"cited_paper":"/paper/2303.17099","citing_paper":"/paper/2508.16408"},"observation_digest":"sha256:dac66ef58eafda99739a6c90881f94b6a24dece58d10e7799e88935d2a0bb368","observation_id":"8f40d86f-8971-48ea-9ff0-3566deccc03b","resolution":{"observed_at":"2026-08-05T17:21:44.599018Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2303.17099","last_updated":"2023-03-30T02:18:07Z","snapshot_observed_at":"2026-08-09T20:13:34.136612Z","submitted_at":"2023-03-30T02:18:07Z","title":"BEVFusion4D: Learning LiDAR-Camera Fusion Under Bird's-Eye-View via Cross-Modality Guidance and Temporal Aggregation","version":1},"cited_work":{"arxiv_id":"2303.17099","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2303.17099","snapshot_observed_at":"2026-07-01T15:05:47.851672Z","title":"Bevfusion4d: Learning lidar-camera fusion under bird’s-eye-view via cross-modality guidance and temporal aggregation","venue":null,"work_id":"e4815434-40a4-493e-95b6-046ebc4ada2c","year":2023},"citing_paper":{"arxiv_id":"2604.02903","last_updated":"2026-04-03T09:20:48Z","snapshot_observed_at":"2026-07-06T22:52:10.923214Z","submitted_at":"2026-04-03T09:20:48Z","title":"RayMamba: Ray-Aligned Serialization for Long-Range 3D Object Detection","version":1},"reference_index":37,"source":"pdf_text","source_observed_at":"2026-05-13T20:25:42.586436Z"},"links":{"cited_paper":"/paper/2303.17099","citing_paper":"/paper/2604.02903"},"observation_digest":"sha256:0806d1df84cf73e4a78b81959380f4299b9c50233d2ac24c6074fdbef87c2782","observation_id":"2da79c8b-a844-4836-9709-b3a699053fbd","resolution":{"observed_at":"2026-05-13T20:28:14.002455Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2303.17099","last_updated":"2023-03-30T02:18:07Z","snapshot_observed_at":"2026-08-09T20:13:34.136612Z","submitted_at":"2023-03-30T02:18:07Z","title":"BEVFusion4D: Learning LiDAR-Camera Fusion Under Bird's-Eye-View via Cross-Modality Guidance and Temporal Aggregation","version":1},"cited_work":{"arxiv_id":"2303.17099","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2303.17099","snapshot_observed_at":"2026-07-01T15:05:47.851672Z","title":"Bevfusion4d: Learning lidar-camera fusion under bird’s-eye-view via cross-modality guidance and temporal aggregation","venue":null,"work_id":"e4815434-40a4-493e-95b6-046ebc4ada2c","year":2023},"citing_paper":{"arxiv_id":"2604.25405","last_updated":"2026-04-28T09:16:44Z","snapshot_observed_at":"2026-07-06T23:11:16.247497Z","submitted_at":"2026-04-28T09:16:44Z","title":"Leveraging Previous-Traversal Point Cloud Map Priors for Camera-Based 3D Object Detection and Tracking","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-05-07T16:46:07.917345Z"},"links":{"cited_paper":"/paper/2303.17099","citing_paper":"/paper/2604.25405"},"observation_digest":"sha256:e669a34d3c1f1b700c8cfd7ee297c11d6b84be1d0394f1c4681c48165216a9a7","observation_id":"649b3570-b11d-4277-9c77-3f711a63fb43","resolution":{"observed_at":"2026-05-11T23:31:17.296061Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2303.17099","last_updated":"2023-03-30T02:18:07Z","snapshot_observed_at":"2026-08-09T20:13:34.136612Z","submitted_at":"2023-03-30T02:18:07Z","title":"BEVFusion4D: Learning LiDAR-Camera Fusion Under Bird's-Eye-View via Cross-Modality Guidance and Temporal Aggregation","version":1},"cited_work":{"arxiv_id":"2303.17099","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2303.17099","snapshot_observed_at":"2026-07-01T15:05:47.851672Z","title":"Bevfusion4d: Learning lidar-camera fusion under bird’s-eye-view via cross-modality guidance and temporal aggregation","venue":null,"work_id":"e4815434-40a4-493e-95b6-046ebc4ada2c","year":2023},"citing_paper":{"arxiv_id":"2604.25574","last_updated":"2026-04-28T12:41:56Z","snapshot_observed_at":"2026-08-02T13:58:54.628028Z","submitted_at":"2026-04-28T12:41:56Z","title":"Control Your Queries: Heterogeneous Query Interaction for Camera-Radar Fusion","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-05-07T16:59:52.889404Z"},"links":{"cited_paper":"/paper/2303.17099","citing_paper":"/paper/2604.25574"},"observation_digest":"sha256:b064c7ebcd61b31b42d844e0cc8a93f6b17f3a4dd44402f880251af3a304f772","observation_id":"6c16e4f6-9bb3-4112-bcfc-1b8228b292ed","resolution":{"observed_at":"2026-05-11T23:26:16.610278Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2303.17099","last_updated":"2023-03-30T02:18:07Z","snapshot_observed_at":"2026-08-09T20:13:34.136612Z","submitted_at":"2023-03-30T02:18:07Z","title":"BEVFusion4D: Learning LiDAR-Camera Fusion Under Bird's-Eye-View via Cross-Modality Guidance and Temporal Aggregation","version":1},"cited_work":{"arxiv_id":"2303.17099","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2303.17099","snapshot_observed_at":"2026-07-01T15:05:47.851672Z","title":"Bevfusion4d: Learning lidar-camera fusion under bird’s-eye-view via cross-modality guidance and temporal aggregation","venue":null,"work_id":"e4815434-40a4-493e-95b6-046ebc4ada2c","year":2023},"citing_paper":{"arxiv_id":"2605.20301","last_updated":"2026-06-01T02:49:14Z","snapshot_observed_at":"2026-08-04T12:53:21.630996Z","submitted_at":"2026-05-19T12:36:09Z","title":"Co-Fusion4D: Spatio-temporal Collaborative Fusion for Robust 3D Object Detection","version":2},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-06-30T18:15:04.759721Z"},"links":{"cited_paper":"/paper/2303.17099","citing_paper":"/paper/2605.20301"},"observation_digest":"sha256:023f25cc97d8433c6d0ed6c53d2e92e856e706b8289f82801c6abe4a6b678a58","observation_id":"58e6d5b6-0b19-4845-8aa3-7399f38d9575","resolution":{"observed_at":"2026-07-01T15:05:47.853244Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}}],"links":{"evidence":"/evidence","html":"/paper/2303.17099/citation-record","integrity":"/paper/2303.17099/integrity","json":"/paper/2303.17099/citation-record.json","paper":"/paper/2303.17099"},"outbound":[],"paper":{"arxiv_id":"2303.17099","last_updated":"2023-03-30T02:18:07Z","latest_version":1,"primary_category":"cs.CV","snapshot_observed_at":"2026-08-09T20:13:34.136612Z","submitted_at":"2023-03-30T02:18:07Z","title":"BEVFusion4D: Learning LiDAR-Camera Fusion Under Bird's-Eye-View via Cross-Modality Guidance and Temporal Aggregation"},"reference_resolution":{"displayed":0,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":0,"verified_exact":0,"verified_fuzzy":0},"total_outbound_references":0},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"thesis":"As of 10 August 2026, this Paper Citation Record lists 0 of 0 outbound references and 8 inbound Pith citation observations for arXiv:2303.17099."}