{"as_of":"2026-08-18T12:24:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:77e2a22151a8d6eaf05be83e777c73d2b1123fb27c8d056489d62820b840b967","coverage":[{"denominator":60,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":60,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-11T04:27:27.407804Z","state":"measured"},{"denominator":61,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":61,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-18T06:34:40.430872+00:00","state":"measured"},{"denominator":1,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":1,"source":"paper_references, paper_reference_links","source_observed_at":"2026-05-10T07:16:33.640040Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"arxiv_reference","source_observed_at":"2026-05-10T07:16:54.772529Z","state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2412.18884","last_updated":"2025-05-21T13:35:40Z","snapshot_observed_at":"2026-08-11T04:19:48.843050Z","submitted_at":"2024-12-25T11:49:14Z","title":"HV-BEV: Decoupling Horizontal and Vertical Feature Sampling for Multi-View 3D Object Detection","version":3},"cited_work":{"arxiv_id":"2412.18884","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2412.18884","snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":null,"venue":null,"work_id":"c811ff10-2acb-4670-aa62-10d5250c2f88","year":2025},"citing_paper":{"arxiv_id":"2604.17024","last_updated":"2026-04-18T15:14:11Z","snapshot_observed_at":"2026-08-11T10:01:58.335054Z","submitted_at":"2026-04-18T15:14:11Z","title":"CAM3DNet: Comprehensively mining the multi-scale features for 3D Object Detection with Multi-View Cameras","version":1},"reference_index":45,"source":"pdf_text","source_observed_at":"2026-05-10T07:16:33.640040Z"},"links":{"cited_paper":"/paper/2412.18884","citing_paper":"/paper/2604.17024"},"observation_digest":"sha256:8f23b58160e9de9e3cdbeae52029b4687b3c08a18b606436d111483da67bfa4c","observation_id":"21067ac5-66d8-4e64-8639-b0ea8d51d5ac","resolution":{"observed_at":"2026-05-10T07:16:54.773677Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}}],"links":{"evidence":"/evidence","html":"/paper/2412.18884/citation-record","integrity":"/paper/2412.18884/integrity","json":"/paper/2412.18884/citation-record.json","paper":"/paper/2412.18884"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T04:27:27.178748Z","title":"3d object detection for autonomous driving: A comprehensive survey,","venue":null,"work_id":null,"year":1909},"citing_paper":{"arxiv_id":"2412.18884","last_updated":"2025-05-21T13:35:40Z","snapshot_observed_at":"2026-08-11T04:19:48.843050Z","submitted_at":"2024-12-25T11:49:14Z","title":"HV-BEV: Decoupling Horizontal and Vertical Feature Sampling for Multi-View 3D Object Detection","version":3},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-11T04:27:27.178748Z"},"links":{"citing_paper":"/paper/2412.18884"},"observation_digest":"sha256:a63e962263f7acbd28780f646d7f1bc1d7730509aeee4be1f2d38eb066c7df0a","observation_id":"248b253c-c2d4-4fd7-8d7f-2f024d07e078","resolution":{"observed_at":"2026-08-11T04:27:27.178748Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T04:27:27.183368Z","title":"V oxelnet: End-to-end learning for point cloud based 3d object detection,","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2412.18884","last_updated":"2025-05-21T13:35:40Z","snapshot_observed_at":"2026-08-11T04:19:48.843050Z","submitted_at":"2024-12-25T11:49:14Z","title":"HV-BEV: Decoupling Horizontal and Vertical Feature Sampling for Multi-View 3D Object Detection","version":3},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-11T04:27:27.183368Z"},"links":{"citing_paper":"/paper/2412.18884"},"observation_digest":"sha256:701b31d4b57beb64c37c6cf7f926b9fc7a8617ec8dfa5e79cce75c1d0da3228b","observation_id":"0e6bfca0-573c-4d0f-9079-4364ad1ba2d1","resolution":{"observed_at":"2026-08-11T04:27:27.183368Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T04:27:28.131030Z","title":"Multi-modal 3d object detection by box matching,","venue":null,"work_id":"22725ba2-983e-4646-ae01-a35007c2bf11","year":2024},"citing_paper":{"arxiv_id":"2412.18884","last_updated":"2025-05-21T13:35:40Z","snapshot_observed_at":"2026-08-11T04:19:48.843050Z","submitted_at":"2024-12-25T11:49:14Z","title":"HV-BEV: Decoupling Horizontal and Vertical Feature Sampling for Multi-View 3D Object Detection","version":3},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-11T04:27:27.187421Z"},"links":{"citing_paper":"/paper/2412.18884"},"observation_digest":"sha256:a3dea731d0717404c69425afedf13f8c7d7cfb8967735d2e74f3fb76aafa501b","observation_id":"8c14506f-11ef-4dde-b8eb-f3b76ca4001b","resolution":{"observed_at":"2026-08-11T04:27:28.135194Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T04:27:28.119729Z","title":"Scnet3d: Rethinking the feature extraction process of pillar-based 3d object detection,","venue":null,"work_id":"0e20f486-c829-4069-a9d9-6690d5e479a2","year":2024},"citing_paper":{"arxiv_id":"2412.18884","last_updated":"2025-05-21T13:35:40Z","snapshot_observed_at":"2026-08-11T04:19:48.843050Z","submitted_at":"2024-12-25T11:49:14Z","title":"HV-BEV: Decoupling Horizontal and Vertical Feature Sampling for Multi-View 3D Object Detection","version":3},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-11T04:27:27.191630Z"},"links":{"citing_paper":"/paper/2412.18884"},"observation_digest":"sha256:204b3da35f3f099e06ddfd67bb02e94264c2621cd4f79433e921f648de1245b4","observation_id":"b71c7548-b8ef-4b9c-853d-5be9e5bed471","resolution":{"observed_at":"2026-08-11T04:27:28.123740Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T04:27:28.108076Z","title":"Vision-centric bev perception: A survey,","venue":null,"work_id":"e08c8e43-9f05-44e8-a256-a0d3510e38dc","year":2024},"citing_paper":{"arxiv_id":"2412.18884","last_updated":"2025-05-21T13:35:40Z","snapshot_observed_at":"2026-08-11T04:19:48.843050Z","submitted_at":"2024-12-25T11:49:14Z","title":"HV-BEV: Decoupling Horizontal and Vertical Feature Sampling for Multi-View 3D Object Detection","version":3},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-11T04:27:27.195789Z"},"links":{"citing_paper":"/paper/2412.18884"},"observation_digest":"sha256:27bcaa0b3fdc67d7fe61aa0a0f829e02c56a4c0ba83ac8ee78d7275652b3602a","observation_id":"ef1ca9e7-fc78-438e-8225-480fcf3b65ba","resolution":{"observed_at":"2026-08-11T04:27:28.112220Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T04:27:27.199813Z","title":"Occformer: Dual-path transformer for vision-based 3d semantic occupancy prediction,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2412.18884","last_updated":"2025-05-21T13:35:40Z","snapshot_observed_at":"2026-08-11T04:19:48.843050Z","submitted_at":"2024-12-25T11:49:14Z","title":"HV-BEV: Decoupling Horizontal and Vertical Feature Sampling for Multi-View 3D Object Detection","version":3},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-11T04:27:27.199813Z"},"links":{"citing_paper":"/paper/2412.18884"},"observation_digest":"sha256:e7f428fd571ad4c54b7cbbfd032bce7537cea1b34081377696e0a83695fc4e5b","observation_id":"d8afe889-cb8f-440c-9ef5-20123cd42550","resolution":{"observed_at":"2026-08-11T04:27:27.199813Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2405.17429","last_updated":"2024-05-27T17:59:51Z","snapshot_observed_at":"2026-08-16T13:48:55.961375Z","submitted_at":"2024-05-27T17:59:51Z","title":"GaussianFormer: Scene as Gaussians for Vision-Based 3D Semantic Occupancy Prediction","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2405.17429","snapshot_observed_at":"2026-08-11T04:27:27.203910Z","title":"Gaussianformer: Scene as gaussians for vision-based 3d semantic occupancy prediction,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2412.18884","last_updated":"2025-05-21T13:35:40Z","snapshot_observed_at":"2026-08-11T04:19:48.843050Z","submitted_at":"2024-12-25T11:49:14Z","title":"HV-BEV: Decoupling Horizontal and Vertical Feature Sampling for Multi-View 3D Object Detection","version":3},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-11T04:27:27.203910Z"},"links":{"cited_paper":"/paper/2405.17429","citing_paper":"/paper/2412.18884"},"observation_digest":"sha256:26b6ddb0596b453cfe021d934dea3704d18e5aa32ad45c24c8ec4fb6867ffa07","observation_id":"f3c91e44-707b-4824-8cfa-566d86d1f6b7","resolution":{"observed_at":"2026-08-11T04:27:27.203910Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2204.05088","last_updated":"2022-04-19T05:40:19Z","snapshot_observed_at":"2026-08-16T17:07:47.661183Z","submitted_at":"2022-04-11T13:43:25Z","title":"M$^2$BEV: Multi-Camera Joint 3D Detection and Segmentation with Unified Birds-Eye View Representation","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2204.05088","snapshot_observed_at":"2026-08-11T04:27:27.208228Z","title":"M 2bev: Multi-camera joint 3d detection and seg- mentation with unified birds-eye view representation,","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2412.18884","last_updated":"2025-05-21T13:35:40Z","snapshot_observed_at":"2026-08-11T04:19:48.843050Z","submitted_at":"2024-12-25T11:49:14Z","title":"HV-BEV: Decoupling Horizontal and Vertical Feature Sampling for Multi-View 3D Object Detection","version":3},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-11T04:27:27.208228Z"},"links":{"cited_paper":"/paper/2204.05088","citing_paper":"/paper/2412.18884"},"observation_digest":"sha256:64fb4256c1825d6d0c200bd599d69c8025907c649c73f7c723628c9c28c06d05","observation_id":"70c963c4-991e-4390-809a-8f95e4a3a565","resolution":{"observed_at":"2026-08-11T04:27:27.208228Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T04:27:28.089505Z","title":"Fast-bev: A fast and strong bird’s-eye view perception baseline,","venue":null,"work_id":"abeebf61-34bc-4f30-86c9-45ce67a19b58","year":2024},"citing_paper":{"arxiv_id":"2412.18884","last_updated":"2025-05-21T13:35:40Z","snapshot_observed_at":"2026-08-11T04:19:48.843050Z","submitted_at":"2024-12-25T11:49:14Z","title":"HV-BEV: Decoupling Horizontal and Vertical Feature Sampling for Multi-View 3D Object Detection","version":3},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-11T04:27:27.212407Z"},"links":{"citing_paper":"/paper/2412.18884"},"observation_digest":"sha256:ebdb8b0fcb503f8594796667ee3c779ef4b5a3eb32c32e079eedf63ab1bc0999","observation_id":"bd71131a-9f0c-4227-bfbd-6c9d29fa6ad9","resolution":{"observed_at":"2026-08-11T04:27:28.093440Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2112.11790","last_updated":"2022-06-16T09:15:52Z","snapshot_observed_at":"2026-08-17T05:15:58.663240Z","submitted_at":"2021-12-22T10:48:06Z","title":"BEVDet: High-performance Multi-camera 3D Object Detection in Bird-Eye-View","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2112.11790","snapshot_observed_at":"2026-08-11T04:27:27.216029Z","title":"Bevdet: High- performance multi-camera 3d object detection in bird-eye-view,","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2412.18884","last_updated":"2025-05-21T13:35:40Z","snapshot_observed_at":"2026-08-11T04:19:48.843050Z","submitted_at":"2024-12-25T11:49:14Z","title":"HV-BEV: Decoupling Horizontal and Vertical Feature Sampling for Multi-View 3D Object Detection","version":3},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-11T04:27:27.216029Z"},"links":{"cited_paper":"/paper/2112.11790","citing_paper":"/paper/2412.18884"},"observation_digest":"sha256:ce8b2518300d6e5d1e6dc7a020cdefbd5aa5520a8572529a115c74966b66d8a0","observation_id":"9f67a98b-312f-4e10-93b3-ee25ab889622","resolution":{"observed_at":"2026-08-11T04:27:27.216029Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2203.17054","last_updated":"2022-06-16T09:44:08Z","snapshot_observed_at":"2026-08-16T17:10:15.129652Z","submitted_at":"2022-03-31T14:21:19Z","title":"BEVDet4D: Exploit Temporal Cues in Multi-camera 3D Object Detection","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2203.17054","snapshot_observed_at":"2026-08-11T04:27:27.220178Z","title":"Bevdet4d: Exploit temporal cues in multi- camera 3d object detection,","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2412.18884","last_updated":"2025-05-21T13:35:40Z","snapshot_observed_at":"2026-08-11T04:19:48.843050Z","submitted_at":"2024-12-25T11:49:14Z","title":"HV-BEV: Decoupling Horizontal and Vertical Feature Sampling for Multi-View 3D Object Detection","version":3},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-11T04:27:27.220178Z"},"links":{"cited_paper":"/paper/2203.17054","citing_paper":"/paper/2412.18884"},"observation_digest":"sha256:aa2ce269a849b3a09aac6a1230c8a56decb89111525f4b0c39d8d9c15eafb282","observation_id":"8bcbeb5a-a193-4348-a1a7-5cc05e6d9bfb","resolution":{"observed_at":"2026-08-11T04:27:27.220178Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T04:27:27.224662Z","title":"Bevdepth: Acquisition of reliable depth for multi-view 3d object detec- tion,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2412.18884","last_updated":"2025-05-21T13:35:40Z","snapshot_observed_at":"2026-08-11T04:19:48.843050Z","submitted_at":"2024-12-25T11:49:14Z","title":"HV-BEV: Decoupling Horizontal and Vertical Feature Sampling for Multi-View 3D Object Detection","version":3},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-11T04:27:27.224662Z"},"links":{"citing_paper":"/paper/2412.18884"},"observation_digest":"sha256:510887f76616e666c78917f203fce63c6caaf387998e475d4f74e6d9ffc70236","observation_id":"cc00ee30-b251-4767-be7f-254a12ddc7b1","resolution":{"observed_at":"2026-08-11T04:27:27.224662Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T04:27:28.071507Z","title":"Bevstereo: Enhancing depth estimation in multi-view 3d object detection with temporal stereo,","venue":null,"work_id":"1a050bee-95d4-431c-bae1-cfb38aef81dc","year":2023},"citing_paper":{"arxiv_id":"2412.18884","last_updated":"2025-05-21T13:35:40Z","snapshot_observed_at":"2026-08-11T04:19:48.843050Z","submitted_at":"2024-12-25T11:49:14Z","title":"HV-BEV: Decoupling Horizontal and Vertical Feature Sampling for Multi-View 3D Object Detection","version":3},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-11T04:27:27.228411Z"},"links":{"citing_paper":"/paper/2412.18884"},"observation_digest":"sha256:6534f0186882816703dc3c3f12dd34521dcc6d22e6f780d772fd107d6b42fc39","observation_id":"fbc1a9d1-bb65-4e69-81dd-055b2c2d87bf","resolution":{"observed_at":"2026-08-11T04:27:28.075429Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T04:27:28.060136Z","title":"Detr3d: 3d object detection from multi-view images via 3d-to-2d queries,","venue":null,"work_id":"73b6f5de-92ac-4ecc-b4a3-3a0d343ec93b","year":2022},"citing_paper":{"arxiv_id":"2412.18884","last_updated":"2025-05-21T13:35:40Z","snapshot_observed_at":"2026-08-11T04:19:48.843050Z","submitted_at":"2024-12-25T11:49:14Z","title":"HV-BEV: Decoupling Horizontal and Vertical Feature Sampling for Multi-View 3D Object Detection","version":3},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-11T04:27:27.232157Z"},"links":{"citing_paper":"/paper/2412.18884"},"observation_digest":"sha256:20fcaf54eb985e481cd41c25f9416fb3320d22a16d7ebc11df418601e2837296","observation_id":"91b53fa8-2882-4495-860a-6c2ff9f29a0b","resolution":{"observed_at":"2026-08-11T04:27:28.064209Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T04:27:28.048138Z","title":"Bevformer: Learning bird’s-eye-view representation from multi-camera images via spatiotemporal transformers,","venue":null,"work_id":"87fd59cb-f3cf-4e47-a62c-dd532e7f5bfc","year":2022},"citing_paper":{"arxiv_id":"2412.18884","last_updated":"2025-05-21T13:35:40Z","snapshot_observed_at":"2026-08-11T04:19:48.843050Z","submitted_at":"2024-12-25T11:49:14Z","title":"HV-BEV: Decoupling Horizontal and Vertical Feature Sampling for Multi-View 3D Object Detection","version":3},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-11T04:27:27.235971Z"},"links":{"citing_paper":"/paper/2412.18884"},"observation_digest":"sha256:178ff86102a30b15192a8506ebd328ab9ca3a333569100a961ce21d059c15496","observation_id":"53d440b7-5f06-4e55-ad0e-4707895f7b93","resolution":{"observed_at":"2026-08-11T04:27:28.052776Z","resolver_source":"raw_fallback","status":"malformed_identifier"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T04:27:28.037038Z","title":"Bevformer v2: Adapting modern image backbones to bird’s-eye-view recognition via perspective supervision,","venue":null,"work_id":"d8f256e3-5790-4f9a-85e3-9b6a8af97a95","year":2023},"citing_paper":{"arxiv_id":"2412.18884","last_updated":"2025-05-21T13:35:40Z","snapshot_observed_at":"2026-08-11T04:19:48.843050Z","submitted_at":"2024-12-25T11:49:14Z","title":"HV-BEV: Decoupling Horizontal and Vertical Feature Sampling for Multi-View 3D Object Detection","version":3},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-11T04:27:27.239801Z"},"links":{"citing_paper":"/paper/2412.18884"},"observation_digest":"sha256:8c106e3b131aef16321de974e4687ecd0ae7897c2706489ebe5994afb5362b65","observation_id":"50e22524-8e29-4411-b747-b4fc5a85a08e","resolution":{"observed_at":"2026-08-11T04:27:28.040928Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T04:27:27.243440Z","title":"Petr: Position embedding trans- formation for multi-view 3d object detection,","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2412.18884","last_updated":"2025-05-21T13:35:40Z","snapshot_observed_at":"2026-08-11T04:19:48.843050Z","submitted_at":"2024-12-25T11:49:14Z","title":"HV-BEV: Decoupling Horizontal and Vertical Feature Sampling for Multi-View 3D Object Detection","version":3},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-11T04:27:27.243440Z"},"links":{"citing_paper":"/paper/2412.18884"},"observation_digest":"sha256:bdccaee81758a45619aaf674d5e774550af5fa49692fcd203a85dadc6585a563","observation_id":"896099cf-dca7-4883-b4f0-6e2a307cf7cb","resolution":{"observed_at":"2026-08-11T04:27:27.243440Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T04:27:27.247374Z","title":"Petrv2: A unified framework for 3d perception from multi-camera images,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2412.18884","last_updated":"2025-05-21T13:35:40Z","snapshot_observed_at":"2026-08-11T04:19:48.843050Z","submitted_at":"2024-12-25T11:49:14Z","title":"HV-BEV: Decoupling Horizontal and Vertical Feature Sampling for Multi-View 3D Object Detection","version":3},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-11T04:27:27.247374Z"},"links":{"citing_paper":"/paper/2412.18884"},"observation_digest":"sha256:5cf8bdc673e879a10c7cb6cd36f716cc5a1dd3023cb4b9ae44649d997c6e5431","observation_id":"a3b68727-33c0-4eab-b68f-a7d7d23eeba2","resolution":{"observed_at":"2026-08-11T04:27:27.247374Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T04:27:28.013177Z","title":"Deformable detr: De- formable transformers for end-to-end object detection,","venue":null,"work_id":"162dc009-7f59-40f4-ab94-308ac97e74f4","year":2021},"citing_paper":{"arxiv_id":"2412.18884","last_updated":"2025-05-21T13:35:40Z","snapshot_observed_at":"2026-08-11T04:19:48.843050Z","submitted_at":"2024-12-25T11:49:14Z","title":"HV-BEV: Decoupling Horizontal and Vertical Feature Sampling for Multi-View 3D Object Detection","version":3},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-11T04:27:27.250945Z"},"links":{"citing_paper":"/paper/2412.18884"},"observation_digest":"sha256:3fb6ace2188fd9b96fe89da553ce4ffb938533e2df01ef514e761419258cfa57","observation_id":"40ae3448-132d-494d-a05a-d558daf7c544","resolution":{"observed_at":"2026-08-11T04:27:28.017273Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T04:27:28.000846Z","title":"Graph-detr3d: rethinking overlapping regions for multi-view 3d object detection,","venue":null,"work_id":"22ca8717-f931-4836-b45d-a0587b028e55","year":2022},"citing_paper":{"arxiv_id":"2412.18884","last_updated":"2025-05-21T13:35:40Z","snapshot_observed_at":"2026-08-11T04:19:48.843050Z","submitted_at":"2024-12-25T11:49:14Z","title":"HV-BEV: Decoupling Horizontal and Vertical Feature Sampling for Multi-View 3D Object Detection","version":3},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-11T04:27:27.255110Z"},"links":{"citing_paper":"/paper/2412.18884"},"observation_digest":"sha256:19a73dfc0b74d43f1a53bef4bca25563545bfa30efb6a1f9dd96dacd2cb26b6c","observation_id":"0aeb239a-2d99-42fa-b53e-4afb4e667f9c","resolution":{"observed_at":"2026-08-11T04:27:28.005571Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T04:27:27.989913Z","title":null,"venue":null,"work_id":"9f478611-c331-4c73-a4e1-899a3a6c28b5","year":2024},"citing_paper":{"arxiv_id":"2412.18884","last_updated":"2025-05-21T13:35:40Z","snapshot_observed_at":"2026-08-11T04:19:48.843050Z","submitted_at":"2024-12-25T11:49:14Z","title":"HV-BEV: Decoupling Horizontal and Vertical Feature Sampling for Multi-View 3D Object Detection","version":3},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-11T04:27:27.258819Z"},"links":{"citing_paper":"/paper/2412.18884"},"observation_digest":"sha256:dc976106410a1a57dfe86827cbee5bb32f15401b74842811e7255eba5d828ab1","observation_id":"4dc490b5-f6f3-4f38-ae38-3be1a87f79bb","resolution":{"observed_at":"2026-08-11T04:27:27.993564Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2211.10581","last_updated":"2023-02-10T05:47:05Z","snapshot_observed_at":"2026-08-16T16:14:57.237141Z","submitted_at":"2022-11-19T04:20:57Z","title":"Sparse4D: Multi-view 3D Object Detection with Sparse Spatial-Temporal Fusion","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2211.10581","snapshot_observed_at":"2026-08-11T04:27:27.262470Z","title":"Sparse4d: Multi-view 3d object detection with sparse spatial-temporal fusion,","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2412.18884","last_updated":"2025-05-21T13:35:40Z","snapshot_observed_at":"2026-08-11T04:19:48.843050Z","submitted_at":"2024-12-25T11:49:14Z","title":"HV-BEV: Decoupling Horizontal and Vertical Feature Sampling for Multi-View 3D Object Detection","version":3},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-11T04:27:27.262470Z"},"links":{"cited_paper":"/paper/2211.10581","citing_paper":"/paper/2412.18884"},"observation_digest":"sha256:afbf8bbf054b1c16e327a6d8f5a350faef2604e1ca3d846b0104c5942c34c635","observation_id":"d7e39313-a5ff-4711-85f6-ac2b31f0499a","resolution":{"observed_at":"2026-08-11T04:27:27.262470Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T04:27:27.978659Z","title":"Bev-san: Accurate bev 3d object detection via slice attention networks,","venue":null,"work_id":"026fef38-003a-49d7-ab0a-5c99d9e3091a","year":2023},"citing_paper":{"arxiv_id":"2412.18884","last_updated":"2025-05-21T13:35:40Z","snapshot_observed_at":"2026-08-11T04:19:48.843050Z","submitted_at":"2024-12-25T11:49:14Z","title":"HV-BEV: Decoupling Horizontal and Vertical Feature Sampling for Multi-View 3D Object Detection","version":3},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-11T04:27:27.266253Z"},"links":{"citing_paper":"/paper/2412.18884"},"observation_digest":"sha256:a58397eec7324da33461f2d907945de8d14bb181bce9007202bceb53a23d682c","observation_id":"cc55cf17-da32-40ea-a376-d0b5076d5bdf","resolution":{"observed_at":"2026-08-11T04:27:27.982599Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T04:27:27.269821Z","title":"Lift, splat, shoot: Encoding images from arbitrary camera rigs by implicitly unprojecting to 3d,","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2412.18884","last_updated":"2025-05-21T13:35:40Z","snapshot_observed_at":"2026-08-11T04:19:48.843050Z","submitted_at":"2024-12-25T11:49:14Z","title":"HV-BEV: Decoupling Horizontal and Vertical Feature Sampling for Multi-View 3D Object Detection","version":3},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-11T04:27:27.269821Z"},"links":{"citing_paper":"/paper/2412.18884"},"observation_digest":"sha256:f9a22a389fbbc6b52ac14e8026fa3ae9bed79f1ad577c490495d10acbb4bf51e","observation_id":"6f699418-a535-49cf-a491-ec69566d8052","resolution":{"observed_at":"2026-08-11T04:27:27.269821Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T04:27:27.273473Z","title":"Categorical depth distribution network for monocular 3d object detection,","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2412.18884","last_updated":"2025-05-21T13:35:40Z","snapshot_observed_at":"2026-08-11T04:19:48.843050Z","submitted_at":"2024-12-25T11:49:14Z","title":"HV-BEV: Decoupling Horizontal and Vertical Feature Sampling for Multi-View 3D Object Detection","version":3},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-08-11T04:27:27.273473Z"},"links":{"citing_paper":"/paper/2412.18884"},"observation_digest":"sha256:f8b329797981ff48b13b019ed10dafc28af33f57163b3b4b62ead7ba0fc4124d","observation_id":"e222962d-755f-4e9b-a8e7-955b439564ce","resolution":{"observed_at":"2026-08-11T04:27:27.273473Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2210.02443","last_updated":"2022-10-05T17:59:51Z","snapshot_observed_at":"2026-08-16T16:26:38.412937Z","submitted_at":"2022-10-05T17:59:51Z","title":"Time Will Tell: New Outlooks and A Baseline for Temporal Multi-View 3D Object Detection","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2210.02443","snapshot_observed_at":"2026-08-11T04:27:27.277881Z","title":"Time will tell: New outlooks and a baseline for temporal multi-view 3d object detection,","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2412.18884","last_updated":"2025-05-21T13:35:40Z","snapshot_observed_at":"2026-08-11T04:19:48.843050Z","submitted_at":"2024-12-25T11:49:14Z","title":"HV-BEV: Decoupling Horizontal and Vertical Feature Sampling for Multi-View 3D Object Detection","version":3},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-08-11T04:27:27.277881Z"},"links":{"cited_paper":"/paper/2210.02443","citing_paper":"/paper/2412.18884"},"observation_digest":"sha256:511f452efe8301f142e1aec7db225328cb94133ae5f3a7026b17c92cef72a10d","observation_id":"b26922af-e3aa-481f-aa88-66fdafde2b6f","resolution":{"observed_at":"2026-08-11T04:27:27.277881Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T04:27:27.953393Z","title":"Fb- bev: Bev representation from forward-backward view transformations,","venue":null,"work_id":"ad9ca730-5d73-49c5-9c59-7a94e03e6cd7","year":2023},"citing_paper":{"arxiv_id":"2412.18884","last_updated":"2025-05-21T13:35:40Z","snapshot_observed_at":"2026-08-11T04:19:48.843050Z","submitted_at":"2024-12-25T11:49:14Z","title":"HV-BEV: Decoupling Horizontal and Vertical Feature Sampling for Multi-View 3D Object Detection","version":3},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-08-11T04:27:27.281931Z"},"links":{"citing_paper":"/paper/2412.18884"},"observation_digest":"sha256:3a4019690af1626a6d644ee6b2e65f703bb3560383f5219477afd255bd834e97","observation_id":"96aa337c-d55e-4b26-98c3-da2fa17b0f7b","resolution":{"observed_at":"2026-08-11T04:27:27.957334Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T04:27:27.941524Z","title":"Bevnext: Reviving dense bev frameworks for 3d object detection,","venue":null,"work_id":"f21a5a03-4625-4969-8e31-b177e268dd0d","year":2024},"citing_paper":{"arxiv_id":"2412.18884","last_updated":"2025-05-21T13:35:40Z","snapshot_observed_at":"2026-08-11T04:19:48.843050Z","submitted_at":"2024-12-25T11:49:14Z","title":"HV-BEV: Decoupling Horizontal and Vertical Feature Sampling for Multi-View 3D Object Detection","version":3},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-08-11T04:27:27.286203Z"},"links":{"citing_paper":"/paper/2412.18884"},"observation_digest":"sha256:f2115a636edebbe52378dabb5daa5f1c9d10086503bf3bd42a5cf88f1c6aa729","observation_id":"0bb2369d-b760-421d-aa56-6b7402afc85e","resolution":{"observed_at":"2026-08-11T04:27:27.945498Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T04:27:27.930699Z","title":"Exploring recurrent long-term temporal fusion for multi-view 3d perception,","venue":null,"work_id":"47a8daf5-3b02-40a6-ae93-6722c16c4358","year":2024},"citing_paper":{"arxiv_id":"2412.18884","last_updated":"2025-05-21T13:35:40Z","snapshot_observed_at":"2026-08-11T04:19:48.843050Z","submitted_at":"2024-12-25T11:49:14Z","title":"HV-BEV: Decoupling Horizontal and Vertical Feature Sampling for Multi-View 3D Object Detection","version":3},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-08-11T04:27:27.289929Z"},"links":{"citing_paper":"/paper/2412.18884"},"observation_digest":"sha256:e27f4489dfbbc240bd0461319c9421b4a5706365c3ccdef33fb5b118d7b58bcf","observation_id":"d1dcdd0b-3cfa-44f6-8d7a-7ab655f8c227","resolution":{"observed_at":"2026-08-11T04:27:27.934529Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2305.14018","last_updated":"2023-05-24T04:00:55Z","snapshot_observed_at":"2026-08-18T05:28:30.614555Z","submitted_at":"2023-05-23T12:53:58Z","title":"Sparse4D v2: Recurrent Temporal Fusion with Sparse Model","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2305.14018","snapshot_observed_at":"2026-08-11T04:27:27.293694Z","title":"Sparse4d v2: Recurrent temporal fusion with sparse model,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2412.18884","last_updated":"2025-05-21T13:35:40Z","snapshot_observed_at":"2026-08-11T04:19:48.843050Z","submitted_at":"2024-12-25T11:49:14Z","title":"HV-BEV: Decoupling Horizontal and Vertical Feature Sampling for Multi-View 3D Object Detection","version":3},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-08-11T04:27:27.293694Z"},"links":{"cited_paper":"/paper/2305.14018","citing_paper":"/paper/2412.18884"},"observation_digest":"sha256:2f7f1e07cf07556f47115a5f9129d7f6cfeacb1175e4367a2ac880a8538989b5","observation_id":"1fda6fd4-fa46-4362-bd4b-dd03275021ff","resolution":{"observed_at":"2026-08-11T04:27:27.293694Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T04:27:27.297713Z","title":"Attention is all you need,","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2412.18884","last_updated":"2025-05-21T13:35:40Z","snapshot_observed_at":"2026-08-11T04:19:48.843050Z","submitted_at":"2024-12-25T11:49:14Z","title":"HV-BEV: Decoupling Horizontal and Vertical Feature Sampling for Multi-View 3D Object Detection","version":3},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-08-11T04:27:27.297713Z"},"links":{"citing_paper":"/paper/2412.18884"},"observation_digest":"sha256:6a7c455ea298ce54e34d6f638e7460d18355b00aeb0c630eb77cf2b83ea53f67","observation_id":"a91c9992-a669-40d2-889a-876176ea1ec6","resolution":{"observed_at":"2026-08-11T04:27:27.297713Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2005.14165","last_updated":"2020-07-22T19:47:17Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2020-05-28T17:29:03Z","title":"Language Models are Few-Shot Learners","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2005.14165","snapshot_observed_at":"2026-08-11T04:27:27.301273Z","title":"Language models are few-shot learners,","venue":null,"work_id":null,"year":2005},"citing_paper":{"arxiv_id":"2412.18884","last_updated":"2025-05-21T13:35:40Z","snapshot_observed_at":"2026-08-11T04:19:48.843050Z","submitted_at":"2024-12-25T11:49:14Z","title":"HV-BEV: Decoupling Horizontal and Vertical Feature Sampling for Multi-View 3D Object Detection","version":3},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-08-11T04:27:27.301273Z"},"links":{"cited_paper":"/paper/2005.14165","citing_paper":"/paper/2412.18884"},"observation_digest":"sha256:d918a1d06d1caadbffb92fb20ce0313ba300836b8797bd52b3941dd263e14262","observation_id":"482967cb-fccb-4fe6-abf9-f53b6da610c7","resolution":{"observed_at":"2026-08-11T04:27:27.301273Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T04:27:27.305312Z","title":"Swin transformer: Hierarchical vision transformer using shifted windows,","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2412.18884","last_updated":"2025-05-21T13:35:40Z","snapshot_observed_at":"2026-08-11T04:19:48.843050Z","submitted_at":"2024-12-25T11:49:14Z","title":"HV-BEV: Decoupling Horizontal and Vertical Feature Sampling for Multi-View 3D Object Detection","version":3},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-08-11T04:27:27.305312Z"},"links":{"citing_paper":"/paper/2412.18884"},"observation_digest":"sha256:e5900fb8d49c23696c6861210ccc53bafd81aa273b03991f73413d7e2b019a03","observation_id":"be41743f-633d-4af3-a93f-64755edfeef9","resolution":{"observed_at":"2026-08-11T04:27:27.305312Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T04:27:27.905957Z","title":"An image is worth 16x16 words: Transformers for image recognition at scale,","venue":null,"work_id":"7c0943ac-77ca-4643-943d-147a1f54eb09","year":2021},"citing_paper":{"arxiv_id":"2412.18884","last_updated":"2025-05-21T13:35:40Z","snapshot_observed_at":"2026-08-11T04:19:48.843050Z","submitted_at":"2024-12-25T11:49:14Z","title":"HV-BEV: Decoupling Horizontal and Vertical Feature Sampling for Multi-View 3D Object Detection","version":3},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-08-11T04:27:27.309228Z"},"links":{"citing_paper":"/paper/2412.18884"},"observation_digest":"sha256:56eff792008c21c771f0da4118ed35ac57dc2f622b8e46fac507c2c97be652bd","observation_id":"953fbd3c-f0b4-4474-a375-7f3b6695152a","resolution":{"observed_at":"2026-08-11T04:27:27.910023Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T04:27:27.894058Z","title":"End-to-end object detection with transformers,","venue":null,"work_id":"1a889570-bd56-443c-a962-1641305bcaf0","year":2020},"citing_paper":{"arxiv_id":"2412.18884","last_updated":"2025-05-21T13:35:40Z","snapshot_observed_at":"2026-08-11T04:19:48.843050Z","submitted_at":"2024-12-25T11:49:14Z","title":"HV-BEV: Decoupling Horizontal and Vertical Feature Sampling for Multi-View 3D Object Detection","version":3},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-08-11T04:27:27.313264Z"},"links":{"citing_paper":"/paper/2412.18884"},"observation_digest":"sha256:4ee163a0f21580a3118c466c860b1bb0de0f6450f6d4cd66c8b303ac77ad752f","observation_id":"9552e644-e8a5-420e-b60b-743fa0fe9f42","resolution":{"observed_at":"2026-08-11T04:27:27.898384Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T04:27:27.317139Z","title":"Detrs beat yolos on real-time object detection,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2412.18884","last_updated":"2025-05-21T13:35:40Z","snapshot_observed_at":"2026-08-11T04:19:48.843050Z","submitted_at":"2024-12-25T11:49:14Z","title":"HV-BEV: Decoupling Horizontal and Vertical Feature Sampling for Multi-View 3D Object Detection","version":3},"reference_index":36,"source":"pdf_text","source_observed_at":"2026-08-11T04:27:27.317139Z"},"links":{"citing_paper":"/paper/2412.18884"},"observation_digest":"sha256:c2ea6aa8e4749aaba322a9d147c939f0945d9a3ce8ac9622485086fe79487414","observation_id":"ef7006e1-0113-4ebf-8031-5141c1459900","resolution":{"observed_at":"2026-08-11T04:27:27.317139Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T04:27:27.875201Z","title":"Heightformer: Explicit height modeling without extra data for camera-only 3d object detection in bird’s eye view,","venue":null,"work_id":"8b4bf25b-7046-4237-8e5e-60086a60f17a","year":2024},"citing_paper":{"arxiv_id":"2412.18884","last_updated":"2025-05-21T13:35:40Z","snapshot_observed_at":"2026-08-11T04:19:48.843050Z","submitted_at":"2024-12-25T11:49:14Z","title":"HV-BEV: Decoupling Horizontal and Vertical Feature Sampling for Multi-View 3D Object Detection","version":3},"reference_index":37,"source":"pdf_text","source_observed_at":"2026-08-11T04:27:27.320707Z"},"links":{"citing_paper":"/paper/2412.18884"},"observation_digest":"sha256:904f4bfe2d4c9ee5647f46fbc06403d810a1b50b2908412886194d0262d3e25c","observation_id":"38a47b6b-1376-49b1-9f95-78e39809f175","resolution":{"observed_at":"2026-08-11T04:27:27.879757Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T04:27:27.324335Z","title":"Bevheight: A robust framework for vision-based roadside 3d object detection,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2412.18884","last_updated":"2025-05-21T13:35:40Z","snapshot_observed_at":"2026-08-11T04:19:48.843050Z","submitted_at":"2024-12-25T11:49:14Z","title":"HV-BEV: Decoupling Horizontal and Vertical Feature Sampling for Multi-View 3D Object Detection","version":3},"reference_index":38,"source":"pdf_text","source_observed_at":"2026-08-11T04:27:27.324335Z"},"links":{"citing_paper":"/paper/2412.18884"},"observation_digest":"sha256:1ba9103b43b36b762c6532b288bcf813dacb26bbc0777970bf9707bec8f2c2b0","observation_id":"5c782aa0-a27c-4120-88ff-e3f47874ffd3","resolution":{"observed_at":"2026-08-11T04:27:27.324335Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2309.16179","last_updated":"2023-09-28T05:38:32Z","snapshot_observed_at":"2026-08-16T14:56:58.815109Z","submitted_at":"2023-09-28T05:38:32Z","title":"BEVHeight++: Toward Robust Visual Centric 3D Object Detection","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2309.16179","snapshot_observed_at":"2026-08-11T04:27:27.327877Z","title":"Bevheight++: Toward robust visual centric 3d object detection,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2412.18884","last_updated":"2025-05-21T13:35:40Z","snapshot_observed_at":"2026-08-11T04:19:48.843050Z","submitted_at":"2024-12-25T11:49:14Z","title":"HV-BEV: Decoupling Horizontal and Vertical Feature Sampling for Multi-View 3D Object Detection","version":3},"reference_index":39,"source":"pdf_text","source_observed_at":"2026-08-11T04:27:27.327877Z"},"links":{"cited_paper":"/paper/2309.16179","citing_paper":"/paper/2412.18884"},"observation_digest":"sha256:51c086ef6eaf7d00c3d5b5bb3d4a5364ff98d6c2b7c4f6eef855d535ddc04047","observation_id":"4de4ccd4-50f8-4b8e-a910-1e9c20b25f52","resolution":{"observed_at":"2026-08-11T04:27:27.327877Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T04:27:27.857017Z","title":"Ocbev: Object-centric bev transformer for multi-view 3d object detection,","venue":null,"work_id":"1548b0ad-6999-4c50-bd62-c03d5b27d9dd","year":2024},"citing_paper":{"arxiv_id":"2412.18884","last_updated":"2025-05-21T13:35:40Z","snapshot_observed_at":"2026-08-11T04:19:48.843050Z","submitted_at":"2024-12-25T11:49:14Z","title":"HV-BEV: Decoupling Horizontal and Vertical Feature Sampling for Multi-View 3D Object Detection","version":3},"reference_index":40,"source":"pdf_text","source_observed_at":"2026-08-11T04:27:27.331342Z"},"links":{"citing_paper":"/paper/2412.18884"},"observation_digest":"sha256:d5ef05cdd6882416840df9c497bda19b34056365da952c736d0227f4a3470543","observation_id":"924f8618-441c-4c52-afd2-86614ebd5e60","resolution":{"observed_at":"2026-08-11T04:27:27.861113Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T04:27:27.335084Z","title":"Deep residual learning for image recognition,","venue":null,"work_id":null,"year":2016},"citing_paper":{"arxiv_id":"2412.18884","last_updated":"2025-05-21T13:35:40Z","snapshot_observed_at":"2026-08-11T04:19:48.843050Z","submitted_at":"2024-12-25T11:49:14Z","title":"HV-BEV: Decoupling Horizontal and Vertical Feature Sampling for Multi-View 3D Object Detection","version":3},"reference_index":41,"source":"pdf_text","source_observed_at":"2026-08-11T04:27:27.335084Z"},"links":{"citing_paper":"/paper/2412.18884"},"observation_digest":"sha256:47ea18a3e5b6e5f201374f5cb1aaff16807280179f650ca18ba4c186d36c1671","observation_id":"26a7b9ad-5462-440c-a93e-b314e3e38e33","resolution":{"observed_at":"2026-08-11T04:27:27.335084Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T04:27:27.338484Z","title":"Feature pyramid networks for object detection,","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2412.18884","last_updated":"2025-05-21T13:35:40Z","snapshot_observed_at":"2026-08-11T04:19:48.843050Z","submitted_at":"2024-12-25T11:49:14Z","title":"HV-BEV: Decoupling Horizontal and Vertical Feature Sampling for Multi-View 3D Object Detection","version":3},"reference_index":42,"source":"pdf_text","source_observed_at":"2026-08-11T04:27:27.338484Z"},"links":{"citing_paper":"/paper/2412.18884"},"observation_digest":"sha256:d024466c17b45bbf7bb9d5ec5d402a0e05cdb9f8a0f4ac2c5c37b1f8dbff1d7c","observation_id":"8004641c-d27b-46a1-9344-e62e1ec7ed28","resolution":{"observed_at":"2026-08-11T04:27:27.338484Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T04:27:27.341982Z","title":"Focal loss for dense object detection,","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2412.18884","last_updated":"2025-05-21T13:35:40Z","snapshot_observed_at":"2026-08-11T04:19:48.843050Z","submitted_at":"2024-12-25T11:49:14Z","title":"HV-BEV: Decoupling Horizontal and Vertical Feature Sampling for Multi-View 3D Object Detection","version":3},"reference_index":43,"source":"pdf_text","source_observed_at":"2026-08-11T04:27:27.341982Z"},"links":{"citing_paper":"/paper/2412.18884"},"observation_digest":"sha256:aa6b869ea2e84f16cd8703b559d0adc76c93bbe8dbce881ef97958698362bfb7","observation_id":"a8b00fcc-3e9d-4bfc-9cc9-d5feae9cdc97","resolution":{"observed_at":"2026-08-11T04:27:27.341982Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T04:27:27.826146Z","title":"nuscenes: A multimodal dataset for autonomous driving,","venue":null,"work_id":"ac652619-72a8-4f69-bdc6-a27efc996e5c","year":2020},"citing_paper":{"arxiv_id":"2412.18884","last_updated":"2025-05-21T13:35:40Z","snapshot_observed_at":"2026-08-11T04:19:48.843050Z","submitted_at":"2024-12-25T11:49:14Z","title":"HV-BEV: Decoupling Horizontal and Vertical Feature Sampling for Multi-View 3D Object Detection","version":3},"reference_index":44,"source":"pdf_text","source_observed_at":"2026-08-11T04:27:27.345826Z"},"links":{"citing_paper":"/paper/2412.18884"},"observation_digest":"sha256:a20cb5f55ac9111628fefcc295ce043f7d8bbb4c8c38ce5ecaf98e3a45c16caf","observation_id":"97eca588-1014-4bd8-9698-cd941ca72128","resolution":{"observed_at":"2026-08-11T04:27:27.830126Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T04:27:27.815358Z","title":"Deformable convolutional networks,","venue":null,"work_id":"d68f3a71-fe93-4fc6-8a37-fd9c63f3c0de","year":2017},"citing_paper":{"arxiv_id":"2412.18884","last_updated":"2025-05-21T13:35:40Z","snapshot_observed_at":"2026-08-11T04:19:48.843050Z","submitted_at":"2024-12-25T11:49:14Z","title":"HV-BEV: Decoupling Horizontal and Vertical Feature Sampling for Multi-View 3D Object Detection","version":3},"reference_index":45,"source":"pdf_text","source_observed_at":"2026-08-11T04:27:27.349639Z"},"links":{"citing_paper":"/paper/2412.18884"},"observation_digest":"sha256:9517714377a9bb8d37df1269f7a3b7a1596dd6c6807616d3df9108d2f837566d","observation_id":"2af96580-a56f-4c1c-854e-5d2631d420aa","resolution":{"observed_at":"2026-08-11T04:27:27.819076Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T04:27:27.804378Z","title":"Fcos3d: Fully convolutional one- stage monocular 3d object detection,","venue":null,"work_id":"5aceb123-70b4-45dc-a2c9-0f114b004063","year":2021},"citing_paper":{"arxiv_id":"2412.18884","last_updated":"2025-05-21T13:35:40Z","snapshot_observed_at":"2026-08-11T04:19:48.843050Z","submitted_at":"2024-12-25T11:49:14Z","title":"HV-BEV: Decoupling Horizontal and Vertical Feature Sampling for Multi-View 3D Object Detection","version":3},"reference_index":46,"source":"pdf_text","source_observed_at":"2026-08-11T04:27:27.353344Z"},"links":{"citing_paper":"/paper/2412.18884"},"observation_digest":"sha256:96b8fa1b0278a6fe88c4329d7816e3f9fecbd0d2be7cccec48234fcddb04b238","observation_id":"03b53805-d924-4ef4-a871-0b23f1e330cd","resolution":{"observed_at":"2026-08-11T04:27:27.808303Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1711.05101","last_updated":"2019-01-04T21:01:49Z","snapshot_observed_at":"2026-08-14T20:13:52.872565Z","submitted_at":"2017-11-14T14:24:06Z","title":"Decoupled Weight Decay Regularization","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1711.05101","snapshot_observed_at":"2026-08-11T04:27:27.356993Z","title":"Decoupled weight decay regularization,","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2412.18884","last_updated":"2025-05-21T13:35:40Z","snapshot_observed_at":"2026-08-11T04:19:48.843050Z","submitted_at":"2024-12-25T11:49:14Z","title":"HV-BEV: Decoupling Horizontal and Vertical Feature Sampling for Multi-View 3D Object Detection","version":3},"reference_index":47,"source":"pdf_text","source_observed_at":"2026-08-11T04:27:27.356993Z"},"links":{"cited_paper":"/paper/1711.05101","citing_paper":"/paper/2412.18884"},"observation_digest":"sha256:6cfac07ca67b017fcdffcbdcf06fdf31b97d8bb1e9cad34be2cfc1714e09e0f4","observation_id":"2e2e4278-1abc-4b1c-9c63-fe1c60680bc6","resolution":{"observed_at":"2026-08-11T04:27:27.356993Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1608.03983","last_updated":"2017-05-03T16:28:09Z","snapshot_observed_at":"2026-07-06T05:06:55.589962Z","submitted_at":"2016-08-13T13:46:05Z","title":"SGDR: Stochastic Gradient Descent with Warm Restarts","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1608.03983","snapshot_observed_at":"2026-08-11T04:27:27.360874Z","title":"Sgdr: Stochastic gradient descent with warm restarts,","venue":null,"work_id":null,"year":2016},"citing_paper":{"arxiv_id":"2412.18884","last_updated":"2025-05-21T13:35:40Z","snapshot_observed_at":"2026-08-11T04:19:48.843050Z","submitted_at":"2024-12-25T11:49:14Z","title":"HV-BEV: Decoupling Horizontal and Vertical Feature Sampling for Multi-View 3D Object Detection","version":3},"reference_index":48,"source":"pdf_text","source_observed_at":"2026-08-11T04:27:27.360874Z"},"links":{"cited_paper":"/paper/1608.03983","citing_paper":"/paper/2412.18884"},"observation_digest":"sha256:7685d06867a8e06ae5c209ddc1f5aa749c708a96cb82ea2f76387e4e95b5b06c","observation_id":"6e827323-b5dd-4243-ba1b-32354e29c8fa","resolution":{"observed_at":"2026-08-11T04:27:27.360874Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T04:27:27.792957Z","title":"Enhancing 3d object detection with 2d detection-guided query anchors,","venue":null,"work_id":"c24e6c98-188c-4714-9514-ada519f628a0","year":2024},"citing_paper":{"arxiv_id":"2412.18884","last_updated":"2025-05-21T13:35:40Z","snapshot_observed_at":"2026-08-11T04:19:48.843050Z","submitted_at":"2024-12-25T11:49:14Z","title":"HV-BEV: Decoupling Horizontal and Vertical Feature Sampling for Multi-View 3D Object Detection","version":3},"reference_index":49,"source":"pdf_text","source_observed_at":"2026-08-11T04:27:27.365084Z"},"links":{"citing_paper":"/paper/2412.18884"},"observation_digest":"sha256:80850fb25482a769366a3756b0f2e91fb20a83dd3b255cd5766fb4e5a9e9f73b","observation_id":"bd894c49-1641-4675-91d6-0c431f495b63","resolution":{"observed_at":"2026-08-11T04:27:27.796795Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2401.03836","last_updated":"2024-07-30T10:36:51Z","snapshot_observed_at":"2026-08-16T14:29:09.026386Z","submitted_at":"2024-01-08T11:50:23Z","title":"WidthFormer: Toward Efficient Transformer-based BEV View Transformation","version":5},"cited_work":{"arxiv_id":"2401.03836","doi":null,"metadata_source":"pith","pith_arxiv_id":"2401.03836","snapshot_observed_at":"2026-08-11T04:27:27.440296Z","title":"WidthFormer: Toward Efficient Transformer-based BEV View Transformation","venue":"cs.CV","work_id":"d072838c-b0f6-4d17-be56-75116ad62567","year":2024},"citing_paper":{"arxiv_id":"2412.18884","last_updated":"2025-05-21T13:35:40Z","snapshot_observed_at":"2026-08-11T04:19:48.843050Z","submitted_at":"2024-12-25T11:49:14Z","title":"HV-BEV: Decoupling Horizontal and Vertical Feature Sampling for Multi-View 3D Object Detection","version":3},"reference_index":50,"source":"pdf_text","source_observed_at":"2026-08-11T04:27:27.368874Z"},"links":{"cited_paper":"/paper/2401.03836","citing_paper":"/paper/2412.18884"},"observation_digest":"sha256:cb1fbb41a6be585182b15ef3f940bd81a82691f84c258f5d23faa80d9783c1dc","observation_id":"28f06a20-9af3-4c30-becc-de0d08fdbcd8","resolution":{"observed_at":"2026-08-11T04:27:27.446532Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T04:27:27.781225Z","title":"An energy and gpu- computation efficient backbone network for real-time object detection,","venue":null,"work_id":"a7fd45b4-f304-44c4-8858-c8830f77b8c1","year":2019},"citing_paper":{"arxiv_id":"2412.18884","last_updated":"2025-05-21T13:35:40Z","snapshot_observed_at":"2026-08-11T04:19:48.843050Z","submitted_at":"2024-12-25T11:49:14Z","title":"HV-BEV: Decoupling Horizontal and Vertical Feature Sampling for Multi-View 3D Object Detection","version":3},"reference_index":51,"source":"pdf_text","source_observed_at":"2026-08-11T04:27:27.372975Z"},"links":{"citing_paper":"/paper/2412.18884"},"observation_digest":"sha256:328ff492de64b0ddf569b19ba27f92d64d8b2fe101926f85352ff8a174ca1837","observation_id":"1de83946-c390-4245-86c9-2a200b6963fe","resolution":{"observed_at":"2026-08-11T04:27:27.785339Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T04:27:27.376725Z","title":"Is pseudo- lidar needed for monocular 3d object detection?","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2412.18884","last_updated":"2025-05-21T13:35:40Z","snapshot_observed_at":"2026-08-11T04:19:48.843050Z","submitted_at":"2024-12-25T11:49:14Z","title":"HV-BEV: Decoupling Horizontal and Vertical Feature Sampling for Multi-View 3D Object Detection","version":3},"reference_index":52,"source":"pdf_text","source_observed_at":"2026-08-11T04:27:27.376725Z"},"links":{"citing_paper":"/paper/2412.18884"},"observation_digest":"sha256:5e9a1fb08ae0c39d5f560d98993f993a7493c71d6f7db91717ff22a6ab2ad6ce","observation_id":"83dfda73-0fbb-47da-b0db-62933af9ca78","resolution":{"observed_at":"2026-08-11T04:27:27.376725Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T04:27:27.762052Z","title":"Viewpoint equivariance for multi-view 3d object detection,","venue":null,"work_id":"0cca10c3-e203-4ce2-8f81-4092887ed0ea","year":2023},"citing_paper":{"arxiv_id":"2412.18884","last_updated":"2025-05-21T13:35:40Z","snapshot_observed_at":"2026-08-11T04:19:48.843050Z","submitted_at":"2024-12-25T11:49:14Z","title":"HV-BEV: Decoupling Horizontal and Vertical Feature Sampling for Multi-View 3D Object Detection","version":3},"reference_index":53,"source":"pdf_text","source_observed_at":"2026-08-11T04:27:27.380596Z"},"links":{"citing_paper":"/paper/2412.18884"},"observation_digest":"sha256:4b00550bf290f105def5fe837e981808575c6b0d4703775c86252000bd975eab","observation_id":"14e143c2-fd9e-4e31-8510-0681b2179acb","resolution":{"observed_at":"2026-08-11T04:27:27.765911Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T04:27:27.750985Z","title":"Lyft level 5 av dataset 2019,","venue":null,"work_id":"d85f263a-c31c-4ce8-bd28-201c908235ef","year":2019},"citing_paper":{"arxiv_id":"2412.18884","last_updated":"2025-05-21T13:35:40Z","snapshot_observed_at":"2026-08-11T04:19:48.843050Z","submitted_at":"2024-12-25T11:49:14Z","title":"HV-BEV: Decoupling Horizontal and Vertical Feature Sampling for Multi-View 3D Object Detection","version":3},"reference_index":54,"source":"pdf_text","source_observed_at":"2026-08-11T04:27:27.384174Z"},"links":{"citing_paper":"/paper/2412.18884"},"observation_digest":"sha256:c73cf7e43ff2d2f80e343f9ef1cd735364b133497a07eaf412d3a568fa1ddc15","observation_id":"11c3c827-5715-445a-8ca9-40ab73eb5e5d","resolution":{"observed_at":"2026-08-11T04:27:27.754728Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T04:27:27.739494Z","title":"MMDetection3D: OpenMMLab next-generation plat- form for general 3D object detection,","venue":null,"work_id":"9d3cb8ab-f555-469b-9172-e044de4704df","year":2020},"citing_paper":{"arxiv_id":"2412.18884","last_updated":"2025-05-21T13:35:40Z","snapshot_observed_at":"2026-08-11T04:19:48.843050Z","submitted_at":"2024-12-25T11:49:14Z","title":"HV-BEV: Decoupling Horizontal and Vertical Feature Sampling for Multi-View 3D Object Detection","version":3},"reference_index":55,"source":"pdf_text","source_observed_at":"2026-08-11T04:27:27.387813Z"},"links":{"citing_paper":"/paper/2412.18884"},"observation_digest":"sha256:fe5392a28eba65851467d14914bc24251ea7329d93f9111cc726984006d70337","observation_id":"799e74dc-676f-4855-ae9c-8deb0c745fc8","resolution":{"observed_at":"2026-08-11T04:27:27.743614Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T04:27:27.728134Z","title":"Atlas: End-to-end 3d scene reconstruction from posed images,","venue":null,"work_id":"4719801a-33a3-4cbc-ab6a-6544c1a69647","year":2020},"citing_paper":{"arxiv_id":"2412.18884","last_updated":"2025-05-21T13:35:40Z","snapshot_observed_at":"2026-08-11T04:19:48.843050Z","submitted_at":"2024-12-25T11:49:14Z","title":"HV-BEV: Decoupling Horizontal and Vertical Feature Sampling for Multi-View 3D Object Detection","version":3},"reference_index":56,"source":"pdf_text","source_observed_at":"2026-08-11T04:27:27.391358Z"},"links":{"citing_paper":"/paper/2412.18884"},"observation_digest":"sha256:c394a61b049f34cd87b6d6ec6ab19dcd287501e10a0fd5dca3b0fef25f9680f6","observation_id":"c7ba6050-8053-42da-ac06-8ace78be7699","resolution":{"observed_at":"2026-08-11T04:27:27.732118Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T04:27:27.716643Z","title":"Surroundocc: Multi-camera 3d occupancy prediction for autonomous driving,","venue":null,"work_id":"79b957ad-2b72-4cd9-a920-a3a035e8574f","year":2023},"citing_paper":{"arxiv_id":"2412.18884","last_updated":"2025-05-21T13:35:40Z","snapshot_observed_at":"2026-08-11T04:19:48.843050Z","submitted_at":"2024-12-25T11:49:14Z","title":"HV-BEV: Decoupling Horizontal and Vertical Feature Sampling for Multi-View 3D Object Detection","version":3},"reference_index":57,"source":"pdf_text","source_observed_at":"2026-08-11T04:27:27.395699Z"},"links":{"citing_paper":"/paper/2412.18884"},"observation_digest":"sha256:52a7c6702f64e250372bc575dc933b9999db51244a89ea51085d6d7682dc1e03","observation_id":"eda0682d-5cae-4a44-9843-8fe66e1932ee","resolution":{"observed_at":"2026-08-11T04:27:27.720674Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T04:27:27.400264Z","title":"Second: Sparsely embedded convolutional detection,","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2412.18884","last_updated":"2025-05-21T13:35:40Z","snapshot_observed_at":"2026-08-11T04:19:48.843050Z","submitted_at":"2024-12-25T11:49:14Z","title":"HV-BEV: Decoupling Horizontal and Vertical Feature Sampling for Multi-View 3D Object Detection","version":3},"reference_index":58,"source":"pdf_text","source_observed_at":"2026-08-11T04:27:27.400264Z"},"links":{"citing_paper":"/paper/2412.18884"},"observation_digest":"sha256:35fa454136c70a11bd2ce3ad25b787866ea39518d6b7deafd39f0c7d135f89eb","observation_id":"1d7d4700-022c-4376-9b53-de1861a1b1a5","resolution":{"observed_at":"2026-08-11T04:27:27.400264Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T04:27:27.403918Z","title":"Pointpillars: Fast encoders for object detection from point clouds,","venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2412.18884","last_updated":"2025-05-21T13:35:40Z","snapshot_observed_at":"2026-08-11T04:19:48.843050Z","submitted_at":"2024-12-25T11:49:14Z","title":"HV-BEV: Decoupling Horizontal and Vertical Feature Sampling for Multi-View 3D Object Detection","version":3},"reference_index":59,"source":"pdf_text","source_observed_at":"2026-08-11T04:27:27.403918Z"},"links":{"citing_paper":"/paper/2412.18884"},"observation_digest":"sha256:7c2a2b1ccf14a988e4d461cbb1ced4adadbdee71d0803a4f2211f16e366a3052","observation_id":"ddfdf997-645a-4dec-9151-8b0042c05056","resolution":{"observed_at":"2026-08-11T04:27:27.403918Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T04:27:27.575847Z","title":"Ssn: Shape signature networks for multi-class object detection from point clouds,","venue":null,"work_id":"906da7eb-11fc-4827-a9f9-fc643f15d0ef","year":2020},"citing_paper":{"arxiv_id":"2412.18884","last_updated":"2025-05-21T13:35:40Z","snapshot_observed_at":"2026-08-11T04:19:48.843050Z","submitted_at":"2024-12-25T11:49:14Z","title":"HV-BEV: Decoupling Horizontal and Vertical Feature Sampling for Multi-View 3D Object Detection","version":3},"reference_index":60,"source":"pdf_text","source_observed_at":"2026-08-11T04:27:27.407804Z"},"links":{"citing_paper":"/paper/2412.18884"},"observation_digest":"sha256:6c7c73b5e36c866a83859653d3db06e18b2957066dba22f82f41fa0d6673678b","observation_id":"8696ae1e-565a-4951-b425-c40c5175f483","resolution":{"observed_at":"2026-08-11T04:27:27.580062Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}}],"paper":{"arxiv_id":"2412.18884","last_updated":"2025-05-21T13:35:40Z","latest_version":3,"primary_category":"cs.CV","snapshot_observed_at":"2026-08-11T04:19:48.843050Z","submitted_at":"2024-12-25T11:49:14Z","title":"HV-BEV: Decoupling Horizontal and Vertical Feature Sampling for Multi-View 3D Object Detection"},"reference_resolution":{"displayed":60,"state_counts":{"malformed_identifier":1,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":30,"verified_exact":1,"verified_fuzzy":28},"total_outbound_references":60},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"thesis":"As of 18 August 2026, this Paper Citation Record lists 60 of 60 outbound references and 1 inbound Pith citation observation for arXiv:2412.18884."}