{"as_of":"2026-08-18T22:40:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:732ac4519959e08e85cb69e4f25d0e18d96cfdbc0642cd29efe2cc4ac8d73e3f","coverage":[{"denominator":60,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":60,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-16T11:10:11.965820Z","state":"measured"},{"denominator":60,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":60,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-18T06:34:40.430872+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2504.16368/citation-record","integrity":"/paper/2504.16368/integrity","json":"/paper/2504.16368/citation-record.json","paper":"/paper/2504.16368"},"outbound":[{"citation":{"cited_paper":{"arxiv_id":"2112.11790","last_updated":"2022-06-16T09:15:52Z","snapshot_observed_at":"2026-08-17T05:15:58.663240Z","submitted_at":"2021-12-22T10:48:06Z","title":"BEVDet: High-performance Multi-camera 3D Object Detection in Bird-Eye-View","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2112.11790","snapshot_observed_at":"2026-08-16T11:10:11.563799Z","title":"Bevdet: High- performance multi-camera 3d object detection in bird-eye-view,","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2504.16368","last_updated":"2025-04-23T02:41:43Z","snapshot_observed_at":"2026-08-18T14:57:39.061247Z","submitted_at":"2025-04-23T02:41:43Z","title":"Revisiting Radar Camera Alignment by Contrastive Learning for 3D Object Detection","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-16T11:10:11.563799Z"},"links":{"cited_paper":"/paper/2112.11790","citing_paper":"/paper/2504.16368"},"observation_digest":"sha256:d9a68539a819ae3bfab197bb3fe936c0e820cac29e3e5e570844f66a3362f9a8","observation_id":"6932ac3c-a27f-4c57-b005-db252a89ff9b","resolution":{"observed_at":"2026-08-16T11:10:11.563799Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T11:10:11.569710Z","title":"Petr: Position embedding trans- formation for multi-view 3d object detection,","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2504.16368","last_updated":"2025-04-23T02:41:43Z","snapshot_observed_at":"2026-08-18T14:57:39.061247Z","submitted_at":"2025-04-23T02:41:43Z","title":"Revisiting Radar Camera Alignment by Contrastive Learning for 3D Object Detection","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-16T11:10:11.569710Z"},"links":{"citing_paper":"/paper/2504.16368"},"observation_digest":"sha256:d98729db78703d746db57187086724017ed514b5a1dc2cc48f3106cc488230c9","observation_id":"0b39b755-21a8-4f2e-ac79-967ea930fe12","resolution":{"observed_at":"2026-08-16T11:10:11.569710Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T11:10:11.574493Z","title":"Exploring object- centric temporal modeling for efficient multi-view 3d object detection,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2504.16368","last_updated":"2025-04-23T02:41:43Z","snapshot_observed_at":"2026-08-18T14:57:39.061247Z","submitted_at":"2025-04-23T02:41:43Z","title":"Revisiting Radar Camera Alignment by Contrastive Learning for 3D Object Detection","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-16T11:10:11.574493Z"},"links":{"citing_paper":"/paper/2504.16368"},"observation_digest":"sha256:5a6b54d7b47aa0940a6796423f616267f5b1f9f6c5f69b6f6e11955b6d11d4b2","observation_id":"a2795354-6e70-4262-83c1-b8dd491ad0ba","resolution":{"observed_at":"2026-08-16T11:10:11.574493Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T11:10:11.579425Z","title":"Bevnext: Reviving dense bev frameworks for 3d object detection,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2504.16368","last_updated":"2025-04-23T02:41:43Z","snapshot_observed_at":"2026-08-18T14:57:39.061247Z","submitted_at":"2025-04-23T02:41:43Z","title":"Revisiting Radar Camera Alignment by Contrastive Learning for 3D Object Detection","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-16T11:10:11.579425Z"},"links":{"citing_paper":"/paper/2504.16368"},"observation_digest":"sha256:9c1cc1d65b50fbde505c654efc29da12bd6b1944c73d500f6f1e300a18d2a7ff","observation_id":"608815c1-c9d7-450f-adf0-89f74f2536c9","resolution":{"observed_at":"2026-08-16T11:10:11.579425Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T11:10:12.653685Z","title":"3dppe: 3d point positional encoding for transformer-based multi-camera 3d object detection,","venue":null,"work_id":"ebb4d3cc-68c2-4922-b45b-06299bd1fd28","year":2023},"citing_paper":{"arxiv_id":"2504.16368","last_updated":"2025-04-23T02:41:43Z","snapshot_observed_at":"2026-08-18T14:57:39.061247Z","submitted_at":"2025-04-23T02:41:43Z","title":"Revisiting Radar Camera Alignment by Contrastive Learning for 3D Object Detection","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-16T11:10:11.584766Z"},"links":{"citing_paper":"/paper/2504.16368"},"observation_digest":"sha256:24fa9749873d122cc5d20b02ddf05abb3460e2bbaaa09cc634a41f6c43bb8bf3","observation_id":"a1060b77-1c01-4113-bdd6-c2465f10924c","resolution":{"observed_at":"2026-08-16T11:10:12.659816Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T11:10:12.638622Z","title":"Graph-detr4d: Spatio-temporal graph modeling for multi-view 3d object detection,","venue":null,"work_id":"f549fff9-cdfe-4e47-900d-ea614649313a","year":2024},"citing_paper":{"arxiv_id":"2504.16368","last_updated":"2025-04-23T02:41:43Z","snapshot_observed_at":"2026-08-18T14:57:39.061247Z","submitted_at":"2025-04-23T02:41:43Z","title":"Revisiting Radar Camera Alignment by Contrastive Learning for 3D Object Detection","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-16T11:10:11.590007Z"},"links":{"citing_paper":"/paper/2504.16368"},"observation_digest":"sha256:176da4cfd16f32fc1b7340760ba13901fb26f0371ce5fc9b5142616e369c9a4b","observation_id":"9ddd5857-d8f5-4dbc-b005-aa487ff8112e","resolution":{"observed_at":"2026-08-16T11:10:12.643347Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2403.07746","last_updated":"2025-03-26T08:48:13Z","snapshot_observed_at":"2026-08-17T23:34:41.690892Z","submitted_at":"2024-03-12T15:28:51Z","title":"Unleashing HyDRa: Hybrid Fusion, Depth Consistency and Radar for Unified 3D Perception","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2403.07746","snapshot_observed_at":"2026-08-16T11:10:11.595180Z","title":"Unleashing hydra: Hybrid fusion, depth consistency and radar for unified 3d perception,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2504.16368","last_updated":"2025-04-23T02:41:43Z","snapshot_observed_at":"2026-08-18T14:57:39.061247Z","submitted_at":"2025-04-23T02:41:43Z","title":"Revisiting Radar Camera Alignment by Contrastive Learning for 3D Object Detection","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-16T11:10:11.595180Z"},"links":{"cited_paper":"/paper/2403.07746","citing_paper":"/paper/2504.16368"},"observation_digest":"sha256:d3ac2c37d96f4a555ffc4ce7b44c95868b50b33b294c866bb6cb47ae33e1555e","observation_id":"374ee0f6-d961-425c-ad2d-5b75b8b95bb5","resolution":{"observed_at":"2026-08-16T11:10:11.595180Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T11:10:12.623596Z","title":"Rcbevdet: Radar-camera fusion in bird’s eye view for 3d object detection,","venue":null,"work_id":"d8f14abf-dccc-4d1a-b1bc-02d9dbc74553","year":2024},"citing_paper":{"arxiv_id":"2504.16368","last_updated":"2025-04-23T02:41:43Z","snapshot_observed_at":"2026-08-18T14:57:39.061247Z","submitted_at":"2025-04-23T02:41:43Z","title":"Revisiting Radar Camera Alignment by Contrastive Learning for 3D Object Detection","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-16T11:10:11.600582Z"},"links":{"citing_paper":"/paper/2504.16368"},"observation_digest":"sha256:c572b6d8a3bf35fc9a54b8c17151bde4fb671c639caf8e74756056e1ec110d37","observation_id":"719da30e-e249-445d-abf5-5fed127b7943","resolution":{"observed_at":"2026-08-16T11:10:12.628408Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T11:10:12.609797Z","title":"Futr3d: A unified sensor fusion framework for 3d detection,","venue":null,"work_id":"4d4c21d3-3699-4426-9491-e53c5d4e24d2","year":2023},"citing_paper":{"arxiv_id":"2504.16368","last_updated":"2025-04-23T02:41:43Z","snapshot_observed_at":"2026-08-18T14:57:39.061247Z","submitted_at":"2025-04-23T02:41:43Z","title":"Revisiting Radar Camera Alignment by Contrastive Learning for 3D Object Detection","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-16T11:10:11.605227Z"},"links":{"citing_paper":"/paper/2504.16368"},"observation_digest":"sha256:e5c1ee13df160d71beac86db9479b5d0afd4b5d465fab2580f3fbef690b2c7ab","observation_id":"b7e1327a-6870-46ec-8b7c-85bbe8c0c2d8","resolution":{"observed_at":"2026-08-16T11:10:12.614054Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T11:10:12.597151Z","title":"Sparsefusion3d: Sparse sensor fusion for 3d object detection by radar and camera in environmental perception,","venue":null,"work_id":"9027cce7-1f06-4792-b34c-593e9cdbc515","year":2023},"citing_paper":{"arxiv_id":"2504.16368","last_updated":"2025-04-23T02:41:43Z","snapshot_observed_at":"2026-08-18T14:57:39.061247Z","submitted_at":"2025-04-23T02:41:43Z","title":"Revisiting Radar Camera Alignment by Contrastive Learning for 3D Object Detection","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-16T11:10:11.609927Z"},"links":{"citing_paper":"/paper/2504.16368"},"observation_digest":"sha256:532767444bc46146f885abf26026526df343d4fa32a4a67f8f6365a98a8d16f5","observation_id":"be43606f-3930-4ee7-a707-46c80562fea8","resolution":{"observed_at":"2026-08-16T11:10:12.601254Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T11:10:12.582908Z","title":"Crn: Camera radar net for accurate, robust, efficient 3d perception,","venue":null,"work_id":"407ff011-f99c-4cdb-bec5-376ab85164e8","year":2023},"citing_paper":{"arxiv_id":"2504.16368","last_updated":"2025-04-23T02:41:43Z","snapshot_observed_at":"2026-08-18T14:57:39.061247Z","submitted_at":"2025-04-23T02:41:43Z","title":"Revisiting Radar Camera Alignment by Contrastive Learning for 3D Object Detection","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-16T11:10:11.614449Z"},"links":{"citing_paper":"/paper/2504.16368"},"observation_digest":"sha256:b34a0a7072fce2bda3a959726c73603adcb82cb7c418e163ec341d4795097740","observation_id":"e3837ed6-ea59-46cc-811f-3452d3f7014c","resolution":{"observed_at":"2026-08-16T11:10:12.587405Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2010.04159","last_updated":"2021-03-18T03:14:26Z","snapshot_observed_at":"2026-08-13T17:54:01.724774Z","submitted_at":"2020-10-08T17:59:21Z","title":"Deformable DETR: Deformable Transformers for End-to-End Object Detection","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2010.04159","snapshot_observed_at":"2026-08-16T11:10:11.618897Z","title":"Deformable detr: Deformable transformers for end-to-end object detection,","venue":null,"work_id":null,"year":2010},"citing_paper":{"arxiv_id":"2504.16368","last_updated":"2025-04-23T02:41:43Z","snapshot_observed_at":"2026-08-18T14:57:39.061247Z","submitted_at":"2025-04-23T02:41:43Z","title":"Revisiting Radar Camera Alignment by Contrastive Learning for 3D Object Detection","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-16T11:10:11.618897Z"},"links":{"cited_paper":"/paper/2010.04159","citing_paper":"/paper/2504.16368"},"observation_digest":"sha256:fc97e824d7973ada7782ce4e42769ae6536095b2c326d0e804b28ac846684a4d","observation_id":"6738784e-cf37-426c-b01c-96c9a7ca8dc4","resolution":{"observed_at":"2026-08-16T11:10:11.618897Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T11:10:11.624442Z","title":"Fcos3d: Fully convolutional one- stage monocular 3d object detection,","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2504.16368","last_updated":"2025-04-23T02:41:43Z","snapshot_observed_at":"2026-08-18T14:57:39.061247Z","submitted_at":"2025-04-23T02:41:43Z","title":"Revisiting Radar Camera Alignment by Contrastive Learning for 3D Object Detection","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-16T11:10:11.624442Z"},"links":{"citing_paper":"/paper/2504.16368"},"observation_digest":"sha256:cc179c44a742205ff7ec309d59f6f187ff30c3869c1121ec0e3752f23d347dd9","observation_id":"47a2a1ae-78e5-4923-8896-2e7b7015fa6d","resolution":{"observed_at":"2026-08-16T11:10:11.624442Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1904.07850","last_updated":"2019-04-25T16:20:02Z","snapshot_observed_at":"2026-08-14T16:45:31.678245Z","submitted_at":"2019-04-16T17:54:26Z","title":"Objects as Points","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1904.07850","snapshot_observed_at":"2026-08-16T11:10:11.628928Z","title":"Objects as points,","venue":null,"work_id":null,"year":1904},"citing_paper":{"arxiv_id":"2504.16368","last_updated":"2025-04-23T02:41:43Z","snapshot_observed_at":"2026-08-18T14:57:39.061247Z","submitted_at":"2025-04-23T02:41:43Z","title":"Revisiting Radar Camera Alignment by Contrastive Learning for 3D Object Detection","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-16T11:10:11.628928Z"},"links":{"cited_paper":"/paper/1904.07850","citing_paper":"/paper/2504.16368"},"observation_digest":"sha256:8b2d9c220bbfe7dbcf058edcd718082ddd7db5562dc86d64a4df569d77ee352c","observation_id":"59e69699-816a-4ada-8e4f-c0cb479b002d","resolution":{"observed_at":"2026-08-16T11:10:11.628928Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T11:10:12.559615Z","title":"Progressive coordinate transforms for monocular 3d object detection,","venue":null,"work_id":"c2bd0987-a722-453c-926b-b6770f601908","year":2021},"citing_paper":{"arxiv_id":"2504.16368","last_updated":"2025-04-23T02:41:43Z","snapshot_observed_at":"2026-08-18T14:57:39.061247Z","submitted_at":"2025-04-23T02:41:43Z","title":"Revisiting Radar Camera Alignment by Contrastive Learning for 3D Object Detection","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-16T11:10:11.633728Z"},"links":{"citing_paper":"/paper/2504.16368"},"observation_digest":"sha256:5e85a18b5ce38695def99bb94edbe03203988104cf03c68a4ceb98de2eb0e289","observation_id":"28546750-89b1-4489-8456-7a1cde35a836","resolution":{"observed_at":"2026-08-16T11:10:12.564609Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T11:10:11.638094Z","title":"Stereoscopic vision recalling memory for monocular 3d object detection,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2504.16368","last_updated":"2025-04-23T02:41:43Z","snapshot_observed_at":"2026-08-18T14:57:39.061247Z","submitted_at":"2025-04-23T02:41:43Z","title":"Revisiting Radar Camera Alignment by Contrastive Learning for 3D Object Detection","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-16T11:10:11.638094Z"},"links":{"citing_paper":"/paper/2504.16368"},"observation_digest":"sha256:3219746fded72a9eb0533f2c978905429ddb483ef44e302c57332a5934703bf2","observation_id":"372d58f1-cf01-45ba-8bf7-eeea65e8205d","resolution":{"observed_at":"2026-08-16T11:10:11.638094Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T11:10:12.537360Z","title":"Obmo: One bounding box multiple objects for monocular 3d object detection,","venue":null,"work_id":"cd78fb20-9cc6-4b07-8d8f-5fbb0f6a3674","year":2023},"citing_paper":{"arxiv_id":"2504.16368","last_updated":"2025-04-23T02:41:43Z","snapshot_observed_at":"2026-08-18T14:57:39.061247Z","submitted_at":"2025-04-23T02:41:43Z","title":"Revisiting Radar Camera Alignment by Contrastive Learning for 3D Object Detection","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-16T11:10:11.642571Z"},"links":{"citing_paper":"/paper/2504.16368"},"observation_digest":"sha256:1d47cb18c72fdc41cb04f00f224421eb2fbe1f664e91bc9d88de476d4e68eda1","observation_id":"1a102649-3c91-4ae1-934e-a777835f0d0d","resolution":{"observed_at":"2026-08-16T11:10:12.541875Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T11:10:12.522669Z","title":"Query-based temporal fusion with explicit motion for 3d object detection,","venue":null,"work_id":"2e767889-f47d-400e-a189-ad5899bb4ae0","year":2024},"citing_paper":{"arxiv_id":"2504.16368","last_updated":"2025-04-23T02:41:43Z","snapshot_observed_at":"2026-08-18T14:57:39.061247Z","submitted_at":"2025-04-23T02:41:43Z","title":"Revisiting Radar Camera Alignment by Contrastive Learning for 3D Object Detection","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-16T11:10:11.647474Z"},"links":{"citing_paper":"/paper/2504.16368"},"observation_digest":"sha256:ccc6461c55b3754ecc340c02e9ec269cd959ac067a36d782f42a590a163a3f52","observation_id":"21e86fde-3e67-41b3-93f2-142d7a2cb32f","resolution":{"observed_at":"2026-08-16T11:10:12.527225Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T11:10:11.651853Z","title":"Detr3d: 3d object detection from multi-view images via 3d-to-2d queries,","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2504.16368","last_updated":"2025-04-23T02:41:43Z","snapshot_observed_at":"2026-08-18T14:57:39.061247Z","submitted_at":"2025-04-23T02:41:43Z","title":"Revisiting Radar Camera Alignment by Contrastive Learning for 3D Object Detection","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-16T11:10:11.651853Z"},"links":{"citing_paper":"/paper/2504.16368"},"observation_digest":"sha256:609f0eea35f33ede88196e533553fe5147de370aa5acd944dbded5dfb3ea222a","observation_id":"05711bc7-5eba-4e8e-9c6b-8ef74ca0250d","resolution":{"observed_at":"2026-08-16T11:10:11.651853Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T11:10:11.657045Z","title":"Bevformer: Learning bird’s-eye-view representation from multi-camera images via spatiotemporal transformers,","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2504.16368","last_updated":"2025-04-23T02:41:43Z","snapshot_observed_at":"2026-08-18T14:57:39.061247Z","submitted_at":"2025-04-23T02:41:43Z","title":"Revisiting Radar Camera Alignment by Contrastive Learning for 3D Object Detection","version":1},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-16T11:10:11.657045Z"},"links":{"citing_paper":"/paper/2504.16368"},"observation_digest":"sha256:69b6d2b34de496a57e2a683081abdaa7733855ca468b35fffca963b5d2bfb159","observation_id":"ed5156df-4d18-4e45-bacc-4073e455188a","resolution":{"observed_at":"2026-08-16T11:10:11.657045Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T11:10:11.662174Z","title":"Bevdepth: Acquisition of reliable depth for multi-view 3d object detec- tion,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2504.16368","last_updated":"2025-04-23T02:41:43Z","snapshot_observed_at":"2026-08-18T14:57:39.061247Z","submitted_at":"2025-04-23T02:41:43Z","title":"Revisiting Radar Camera Alignment by Contrastive Learning for 3D Object Detection","version":1},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-16T11:10:11.662174Z"},"links":{"citing_paper":"/paper/2504.16368"},"observation_digest":"sha256:4438228364bcefc63d6bfe0e6336642cbe3c8dd39793654ae418fae7f5436cb7","observation_id":"17eddc5e-8408-471e-b277-391cbf62b76b","resolution":{"observed_at":"2026-08-16T11:10:11.662174Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T11:10:11.666865Z","title":"Bevformer v2: Adapting modern image backbones to bird’s-eye-view recognition via perspective supervision,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2504.16368","last_updated":"2025-04-23T02:41:43Z","snapshot_observed_at":"2026-08-18T14:57:39.061247Z","submitted_at":"2025-04-23T02:41:43Z","title":"Revisiting Radar Camera Alignment by Contrastive Learning for 3D Object Detection","version":1},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-16T11:10:11.666865Z"},"links":{"citing_paper":"/paper/2504.16368"},"observation_digest":"sha256:a851e31520175085446400c8aac5bb60e859535b53d185016ac54b1e13e3d196","observation_id":"719cc0e6-23b0-454e-8a38-2dc6fe8bcc00","resolution":{"observed_at":"2026-08-16T11:10:11.666865Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2204.05088","last_updated":"2022-04-19T05:40:19Z","snapshot_observed_at":"2026-08-16T17:07:47.661183Z","submitted_at":"2022-04-11T13:43:25Z","title":"M$^2$BEV: Multi-Camera Joint 3D Detection and Segmentation with Unified Birds-Eye View Representation","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2204.05088","snapshot_observed_at":"2026-08-16T11:10:11.671588Z","title":"M 2 bev: Multi-camera joint 3d detection and segmentation with unified birds-eye view representation,","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2504.16368","last_updated":"2025-04-23T02:41:43Z","snapshot_observed_at":"2026-08-18T14:57:39.061247Z","submitted_at":"2025-04-23T02:41:43Z","title":"Revisiting Radar Camera Alignment by Contrastive Learning for 3D Object Detection","version":1},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-16T11:10:11.671588Z"},"links":{"cited_paper":"/paper/2204.05088","citing_paper":"/paper/2504.16368"},"observation_digest":"sha256:4ea08380f25adb94f3d6de811034c7374e2fa786b977d312a8c7524d177fe125","observation_id":"4f954abe-9508-48d6-9e3d-47cade9fbe52","resolution":{"observed_at":"2026-08-16T11:10:11.671588Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T11:10:11.676387Z","title":"Bevstereo: Enhancing depth estimation in multi-view 3d object detection with temporal stereo,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2504.16368","last_updated":"2025-04-23T02:41:43Z","snapshot_observed_at":"2026-08-18T14:57:39.061247Z","submitted_at":"2025-04-23T02:41:43Z","title":"Revisiting Radar Camera Alignment by Contrastive Learning for 3D Object Detection","version":1},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-16T11:10:11.676387Z"},"links":{"citing_paper":"/paper/2504.16368"},"observation_digest":"sha256:255bd93c8c1a8938522a08ff72075e2bdb3fa44f0576bb60ca85e741f25be16c","observation_id":"2209f5f1-e9de-41fc-b613-883b96aa87f5","resolution":{"observed_at":"2026-08-16T11:10:11.676387Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T11:10:12.463362Z","title":"Cobev: Elevating roadside 3d object detection with depth and height complementarity,","venue":null,"work_id":"bc7e4158-4470-4242-a1ac-e954947e920d","year":2024},"citing_paper":{"arxiv_id":"2504.16368","last_updated":"2025-04-23T02:41:43Z","snapshot_observed_at":"2026-08-18T14:57:39.061247Z","submitted_at":"2025-04-23T02:41:43Z","title":"Revisiting Radar Camera Alignment by Contrastive Learning for 3D Object Detection","version":1},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-08-16T11:10:11.681005Z"},"links":{"citing_paper":"/paper/2504.16368"},"observation_digest":"sha256:0a2c7ee24ae6f64a3bc62183791ee0341e18ac7db0dd29775d04906e27d7ae6d","observation_id":"699226f6-8b8e-4314-8351-83d1c3a02d45","resolution":{"observed_at":"2026-08-16T11:10:12.468617Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2211.10581","last_updated":"2023-02-10T05:47:05Z","snapshot_observed_at":"2026-08-16T16:14:57.237141Z","submitted_at":"2022-11-19T04:20:57Z","title":"Sparse4D: Multi-view 3D Object Detection with Sparse Spatial-Temporal Fusion","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2211.10581","snapshot_observed_at":"2026-08-16T11:10:11.686107Z","title":"Sparse4d: Multi-view 3d object detection with sparse spatial-temporal fusion,","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2504.16368","last_updated":"2025-04-23T02:41:43Z","snapshot_observed_at":"2026-08-18T14:57:39.061247Z","submitted_at":"2025-04-23T02:41:43Z","title":"Revisiting Radar Camera Alignment by Contrastive Learning for 3D Object Detection","version":1},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-08-16T11:10:11.686107Z"},"links":{"cited_paper":"/paper/2211.10581","citing_paper":"/paper/2504.16368"},"observation_digest":"sha256:bd7e833a95fd7ae1b0798a0e5020f237fcac475490653e418468cacf5004aeea","observation_id":"6314db29-6e46-44ae-8cf6-e0c4bb7a1304","resolution":{"observed_at":"2026-08-16T11:10:11.686107Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T11:10:11.690982Z","title":"Lift, splat, shoot: Encoding images from arbitrary camera rigs by implicitly unprojecting to 3d,","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2504.16368","last_updated":"2025-04-23T02:41:43Z","snapshot_observed_at":"2026-08-18T14:57:39.061247Z","submitted_at":"2025-04-23T02:41:43Z","title":"Revisiting Radar Camera Alignment by Contrastive Learning for 3D Object Detection","version":1},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-08-16T11:10:11.690982Z"},"links":{"citing_paper":"/paper/2504.16368"},"observation_digest":"sha256:e8326e8745b9f24fb883a7be8a7bbe6941276f37f5c6a2031953849a338d2067","observation_id":"0c41ffcc-f359-4302-b76f-21a35d2500fe","resolution":{"observed_at":"2026-08-16T11:10:11.690982Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2203.17054","last_updated":"2022-06-16T09:44:08Z","snapshot_observed_at":"2026-08-16T17:10:15.129652Z","submitted_at":"2022-03-31T14:21:19Z","title":"BEVDet4D: Exploit Temporal Cues in Multi-camera 3D Object Detection","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2203.17054","snapshot_observed_at":"2026-08-16T11:10:11.697015Z","title":"Bevdet4d: Exploit temporal cues in multi- camera 3d object detection,","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2504.16368","last_updated":"2025-04-23T02:41:43Z","snapshot_observed_at":"2026-08-18T14:57:39.061247Z","submitted_at":"2025-04-23T02:41:43Z","title":"Revisiting Radar Camera Alignment by Contrastive Learning for 3D Object Detection","version":1},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-08-16T11:10:11.697015Z"},"links":{"cited_paper":"/paper/2203.17054","citing_paper":"/paper/2504.16368"},"observation_digest":"sha256:6f047c873e7bc375554b7971e4ee15363f70f135bd97685c796ebf3cbc2b8383","observation_id":"1fb64b7a-eca9-4069-9f8e-931fb31fd0f9","resolution":{"observed_at":"2026-08-16T11:10:11.697015Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2211.17111","last_updated":"2022-11-30T15:55:38Z","snapshot_observed_at":"2026-08-16T16:12:02.651675Z","submitted_at":"2022-11-30T15:55:38Z","title":"BEVPoolv2: A Cutting-edge Implementation of BEVDet Toward Deployment","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2211.17111","snapshot_observed_at":"2026-08-16T11:10:11.701804Z","title":"Bevpoolv2: A cutting-edge implementation of bevdet toward deployment,","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2504.16368","last_updated":"2025-04-23T02:41:43Z","snapshot_observed_at":"2026-08-18T14:57:39.061247Z","submitted_at":"2025-04-23T02:41:43Z","title":"Revisiting Radar Camera Alignment by Contrastive Learning for 3D Object Detection","version":1},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-08-16T11:10:11.701804Z"},"links":{"cited_paper":"/paper/2211.17111","citing_paper":"/paper/2504.16368"},"observation_digest":"sha256:57d0647d43ec49395c3c1a906c111ab1c0de53eff2f4bfe4b0d7e764e80e1756","observation_id":"bf4adc1d-236f-44fe-8ec6-4ccce05eec3c","resolution":{"observed_at":"2026-08-16T11:10:11.701804Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T11:10:12.439864Z","title":"Centerfusion: Center-based radar and camera fusion for 3d object detection,","venue":null,"work_id":"137b8940-8f3e-4a5d-85f1-ea761fe2869d","year":2021},"citing_paper":{"arxiv_id":"2504.16368","last_updated":"2025-04-23T02:41:43Z","snapshot_observed_at":"2026-08-18T14:57:39.061247Z","submitted_at":"2025-04-23T02:41:43Z","title":"Revisiting Radar Camera Alignment by Contrastive Learning for 3D Object Detection","version":1},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-08-16T11:10:11.706410Z"},"links":{"citing_paper":"/paper/2504.16368"},"observation_digest":"sha256:e28b232fd8a56ac327238a71f1ffcdd79392777546263d90256340a1114e6ed0","observation_id":"10dd0b13-504f-46fd-b5b0-3a4d07a2c7ba","resolution":{"observed_at":"2026-08-16T11:10:12.444240Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T11:10:12.426276Z","title":"Radiant: Radar-image association network for 3d object detection,","venue":null,"work_id":"4c6c3521-c253-41e9-9589-b6624b24b4b1","year":2023},"citing_paper":{"arxiv_id":"2504.16368","last_updated":"2025-04-23T02:41:43Z","snapshot_observed_at":"2026-08-18T14:57:39.061247Z","submitted_at":"2025-04-23T02:41:43Z","title":"Revisiting Radar Camera Alignment by Contrastive Learning for 3D Object Detection","version":1},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-08-16T11:10:11.710940Z"},"links":{"citing_paper":"/paper/2504.16368"},"observation_digest":"sha256:db824aa375f8cc490d4652fa44415342db6a99fcea25f178d5aa0c0ddc31af41","observation_id":"7f9be76c-e5c7-4a56-8502-1a92982876c1","resolution":{"observed_at":"2026-08-16T11:10:12.430737Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T11:10:12.412665Z","title":"Craft: Camera-radar 3d object detection with spatio-contextual fusion transformer,","venue":null,"work_id":"37eb403c-e718-4de2-8078-23b8d75b0178","year":2023},"citing_paper":{"arxiv_id":"2504.16368","last_updated":"2025-04-23T02:41:43Z","snapshot_observed_at":"2026-08-18T14:57:39.061247Z","submitted_at":"2025-04-23T02:41:43Z","title":"Revisiting Radar Camera Alignment by Contrastive Learning for 3D Object Detection","version":1},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-08-16T11:10:11.715658Z"},"links":{"citing_paper":"/paper/2504.16368"},"observation_digest":"sha256:1807a8511d2616b3b07dac0ca965c291297b2f8468fa16f8e460ae9ab243c404","observation_id":"eedd766c-0d87-4037-b369-f96d441a2152","resolution":{"observed_at":"2026-08-16T11:10:12.417087Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T11:10:12.399317Z","title":"Mvfusion: Multi-view 3d object detection with semantic-aligned radar and camera fusion,","venue":null,"work_id":"859debc5-3f54-4bdb-9a90-6f9014100d1b","year":2023},"citing_paper":{"arxiv_id":"2504.16368","last_updated":"2025-04-23T02:41:43Z","snapshot_observed_at":"2026-08-18T14:57:39.061247Z","submitted_at":"2025-04-23T02:41:43Z","title":"Revisiting Radar Camera Alignment by Contrastive Learning for 3D Object Detection","version":1},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-08-16T11:10:11.719977Z"},"links":{"citing_paper":"/paper/2504.16368"},"observation_digest":"sha256:cac30f7b506d103782a8a52065003980db731abcc04a2d2fcd8928e5f31e1af7","observation_id":"4dd96728-f01f-40de-a65e-063689c61e38","resolution":{"observed_at":"2026-08-16T11:10:12.403745Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T11:10:11.725049Z","title":"Dimensionality reduction by learning an invariant mapping,","venue":null,"work_id":null,"year":2006},"citing_paper":{"arxiv_id":"2504.16368","last_updated":"2025-04-23T02:41:43Z","snapshot_observed_at":"2026-08-18T14:57:39.061247Z","submitted_at":"2025-04-23T02:41:43Z","title":"Revisiting Radar Camera Alignment by Contrastive Learning for 3D Object Detection","version":1},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-08-16T11:10:11.725049Z"},"links":{"citing_paper":"/paper/2504.16368"},"observation_digest":"sha256:8b1b26e30cc300a2c5684da7e38e9c544e8e36426f565b807ccbf566bf9abb22","observation_id":"24646509-724d-4328-9946-ebabe5ea4fa6","resolution":{"observed_at":"2026-08-16T11:10:11.725049Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T11:10:11.860697Z","title":"Momentum contrast for unsupervised visual representation learning,","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2504.16368","last_updated":"2025-04-23T02:41:43Z","snapshot_observed_at":"2026-08-18T14:57:39.061247Z","submitted_at":"2025-04-23T02:41:43Z","title":"Revisiting Radar Camera Alignment by Contrastive Learning for 3D Object Detection","version":1},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-08-16T11:10:11.860697Z"},"links":{"citing_paper":"/paper/2504.16368"},"observation_digest":"sha256:b3f73546cdfa18cb44a39d5069d41f8051c67736d954b24d302d106c432d7cb5","observation_id":"1fd1a261-93bd-4dfb-8da5-5afb37f62e8e","resolution":{"observed_at":"2026-08-16T11:10:11.860697Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T11:10:11.866028Z","title":"A simple framework for contrastive learning of visual representations,","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2504.16368","last_updated":"2025-04-23T02:41:43Z","snapshot_observed_at":"2026-08-18T14:57:39.061247Z","submitted_at":"2025-04-23T02:41:43Z","title":"Revisiting Radar Camera Alignment by Contrastive Learning for 3D Object Detection","version":1},"reference_index":36,"source":"pdf_text","source_observed_at":"2026-08-16T11:10:11.866028Z"},"links":{"citing_paper":"/paper/2504.16368"},"observation_digest":"sha256:ccee5a84f93e6f780f7445b624aaf506a1f7bb81a55dcb65f5a6a9b1df83de49","observation_id":"1f22a881-51d6-4100-9d82-3b5c7ea8947e","resolution":{"observed_at":"2026-08-16T11:10:11.866028Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T11:10:12.358185Z","title":"Aligning pretraining for detection via object-level contrastive learning,","venue":null,"work_id":"4b7ae697-6ec8-4bcf-b42c-5ba671827379","year":2021},"citing_paper":{"arxiv_id":"2504.16368","last_updated":"2025-04-23T02:41:43Z","snapshot_observed_at":"2026-08-18T14:57:39.061247Z","submitted_at":"2025-04-23T02:41:43Z","title":"Revisiting Radar Camera Alignment by Contrastive Learning for 3D Object Detection","version":1},"reference_index":37,"source":"pdf_text","source_observed_at":"2026-08-16T11:10:11.870513Z"},"links":{"citing_paper":"/paper/2504.16368"},"observation_digest":"sha256:a9a0c9f428b37affcb28f9ef25ddcca45441ff5db207e851191d3d3fb2e78abb","observation_id":"ab57de51-29f0-498b-b18f-f3db791022fb","resolution":{"observed_at":"2026-08-16T11:10:12.362659Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T11:10:12.343638Z","title":"Fsce: Few-shot object detection via contrastive proposal encoding,","venue":null,"work_id":"a08ed69b-174a-486c-b347-70956a6de383","year":2021},"citing_paper":{"arxiv_id":"2504.16368","last_updated":"2025-04-23T02:41:43Z","snapshot_observed_at":"2026-08-18T14:57:39.061247Z","submitted_at":"2025-04-23T02:41:43Z","title":"Revisiting Radar Camera Alignment by Contrastive Learning for 3D Object Detection","version":1},"reference_index":38,"source":"pdf_text","source_observed_at":"2026-08-16T11:10:11.874471Z"},"links":{"citing_paper":"/paper/2504.16368"},"observation_digest":"sha256:a854feb049ef66e385043da3c2b6c8a6cbc4b94108ec3142154614ba9668e462","observation_id":"c2bbca37-e14a-40fc-a5ce-4f9e2e076990","resolution":{"observed_at":"2026-08-16T11:10:12.348164Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T11:10:11.878980Z","title":"Cat-det: Contrastively augmented transformer for multi-modal 3d object detection,","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2504.16368","last_updated":"2025-04-23T02:41:43Z","snapshot_observed_at":"2026-08-18T14:57:39.061247Z","submitted_at":"2025-04-23T02:41:43Z","title":"Revisiting Radar Camera Alignment by Contrastive Learning for 3D Object Detection","version":1},"reference_index":39,"source":"pdf_text","source_observed_at":"2026-08-16T11:10:11.878980Z"},"links":{"citing_paper":"/paper/2504.16368"},"observation_digest":"sha256:7044365d77beb055383963e46cb2e0f2afe76b94de5af7dd1c73a094bc8d6a50","observation_id":"f482d8c1-b2d1-4cdf-862f-a6dceba117c1","resolution":{"observed_at":"2026-08-16T11:10:11.878980Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T11:10:11.882751Z","title":"Feature pyramid networks for object detection,","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2504.16368","last_updated":"2025-04-23T02:41:43Z","snapshot_observed_at":"2026-08-18T14:57:39.061247Z","submitted_at":"2025-04-23T02:41:43Z","title":"Revisiting Radar Camera Alignment by Contrastive Learning for 3D Object Detection","version":1},"reference_index":40,"source":"pdf_text","source_observed_at":"2026-08-16T11:10:11.882751Z"},"links":{"citing_paper":"/paper/2504.16368"},"observation_digest":"sha256:a12dcfd8f174c2a7ee89c6bd67a1c21b08c27cb3d0e3437a01f502742bd2bb0e","observation_id":"00f03197-22b7-42eb-8d2b-d910ee8a118e","resolution":{"observed_at":"2026-08-16T11:10:11.882751Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T11:10:11.886529Z","title":"Pointpillars: Fast encoders for object detection from point clouds,","venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2504.16368","last_updated":"2025-04-23T02:41:43Z","snapshot_observed_at":"2026-08-18T14:57:39.061247Z","submitted_at":"2025-04-23T02:41:43Z","title":"Revisiting Radar Camera Alignment by Contrastive Learning for 3D Object Detection","version":1},"reference_index":41,"source":"pdf_text","source_observed_at":"2026-08-16T11:10:11.886529Z"},"links":{"citing_paper":"/paper/2504.16368"},"observation_digest":"sha256:fa894af023167a2304f8dbf83ee121f4b3d6408f358f58729f1fc4a6ab987ab1","observation_id":"08a4b010-8d75-4c5a-a602-487ff412a90e","resolution":{"observed_at":"2026-08-16T11:10:11.886529Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T11:10:11.890802Z","title":"Learning transferable visual models from natural language supervision,","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2504.16368","last_updated":"2025-04-23T02:41:43Z","snapshot_observed_at":"2026-08-18T14:57:39.061247Z","submitted_at":"2025-04-23T02:41:43Z","title":"Revisiting Radar Camera Alignment by Contrastive Learning for 3D Object Detection","version":1},"reference_index":42,"source":"pdf_text","source_observed_at":"2026-08-16T11:10:11.890802Z"},"links":{"citing_paper":"/paper/2504.16368"},"observation_digest":"sha256:8648b1c41c1f9b2dbf79a8653e1633ea3d17a3af4a8cd32a58e8f917f154412f","observation_id":"22864e52-6320-4d24-8176-929239c0e731","resolution":{"observed_at":"2026-08-16T11:10:11.890802Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T11:10:11.895497Z","title":"Batch normalization: Accelerating deep network training by reducing internal covariate shift,","venue":null,"work_id":null,"year":2015},"citing_paper":{"arxiv_id":"2504.16368","last_updated":"2025-04-23T02:41:43Z","snapshot_observed_at":"2026-08-18T14:57:39.061247Z","submitted_at":"2025-04-23T02:41:43Z","title":"Revisiting Radar Camera Alignment by Contrastive Learning for 3D Object Detection","version":1},"reference_index":43,"source":"pdf_text","source_observed_at":"2026-08-16T11:10:11.895497Z"},"links":{"citing_paper":"/paper/2504.16368"},"observation_digest":"sha256:eb529699818a6e334ce53f2cda6adc3184ab5b07ceefa87cd1078e2e9b612767","observation_id":"f931482d-8137-4871-bcb9-35c0f0435a3e","resolution":{"observed_at":"2026-08-16T11:10:11.895497Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T11:10:11.900105Z","title":"Rectified linear units improve restricted boltz- mann machines,","venue":null,"work_id":null,"year":2010},"citing_paper":{"arxiv_id":"2504.16368","last_updated":"2025-04-23T02:41:43Z","snapshot_observed_at":"2026-08-18T14:57:39.061247Z","submitted_at":"2025-04-23T02:41:43Z","title":"Revisiting Radar Camera Alignment by Contrastive Learning for 3D Object Detection","version":1},"reference_index":44,"source":"pdf_text","source_observed_at":"2026-08-16T11:10:11.900105Z"},"links":{"citing_paper":"/paper/2504.16368"},"observation_digest":"sha256:005643dbe697ec5ac47d3dbca5e291a5ed69aef6ac5b4cf041ad15d63999037a","observation_id":"2c9be7f8-37fa-459e-8f6b-5b0ebe4536f1","resolution":{"observed_at":"2026-08-16T11:10:11.900105Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1503.02531","last_updated":"2015-03-09T15:44:49Z","snapshot_observed_at":"2026-08-16T18:00:58.008096Z","submitted_at":"2015-03-09T15:44:49Z","title":"Distilling the Knowledge in a Neural Network","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1503.02531","snapshot_observed_at":"2026-08-16T11:10:11.904424Z","title":"Distilling the knowledge in a neural network,","venue":null,"work_id":null,"year":2015},"citing_paper":{"arxiv_id":"2504.16368","last_updated":"2025-04-23T02:41:43Z","snapshot_observed_at":"2026-08-18T14:57:39.061247Z","submitted_at":"2025-04-23T02:41:43Z","title":"Revisiting Radar Camera Alignment by Contrastive Learning for 3D Object Detection","version":1},"reference_index":45,"source":"pdf_text","source_observed_at":"2026-08-16T11:10:11.904424Z"},"links":{"cited_paper":"/paper/1503.02531","citing_paper":"/paper/2504.16368"},"observation_digest":"sha256:5eda2d59f29d7d22a3e15b25f9d28774c5f5ec0f445bfb26b5459d1e990860dd","observation_id":"d776a076-027d-4636-9d74-a226f8e96dbf","resolution":{"observed_at":"2026-08-16T11:10:11.904424Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T11:10:12.275428Z","title":"Time will tell: New outlooks and a baseline for temporal multi-view 3d object detection,","venue":null,"work_id":"d20f3338-5401-47f3-a2ba-191459905dcb","year":2022},"citing_paper":{"arxiv_id":"2504.16368","last_updated":"2025-04-23T02:41:43Z","snapshot_observed_at":"2026-08-18T14:57:39.061247Z","submitted_at":"2025-04-23T02:41:43Z","title":"Revisiting Radar Camera Alignment by Contrastive Learning for 3D Object Detection","version":1},"reference_index":46,"source":"pdf_text","source_observed_at":"2026-08-16T11:10:11.908876Z"},"links":{"citing_paper":"/paper/2504.16368"},"observation_digest":"sha256:25c5eb99ee1d12d56ee767d13907ffac8f847177adcb6da88f433c5c22c51535","observation_id":"ec2281ef-a251-453f-861f-fbfe881d4e74","resolution":{"observed_at":"2026-08-16T11:10:12.281172Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T11:10:11.913075Z","title":"Sparsebev: High- performance sparse 3d object detection from multi-camera videos,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2504.16368","last_updated":"2025-04-23T02:41:43Z","snapshot_observed_at":"2026-08-18T14:57:39.061247Z","submitted_at":"2025-04-23T02:41:43Z","title":"Revisiting Radar Camera Alignment by Contrastive Learning for 3D Object Detection","version":1},"reference_index":47,"source":"pdf_text","source_observed_at":"2026-08-16T11:10:11.913075Z"},"links":{"citing_paper":"/paper/2504.16368"},"observation_digest":"sha256:f0aaebc56ad807783b62d2a3282fcea2dd5ece1a8b3317a0b9213ac9932641ae","observation_id":"2d35f54b-d56f-4ed7-a870-0a6476442e2b","resolution":{"observed_at":"2026-08-16T11:10:11.913075Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T11:10:12.252671Z","title":"Bridging the view disparity between radar and camera features for multi-modal fusion 3d object detection,","venue":null,"work_id":"5aad9ded-3a25-4468-9b9f-72140974ab25","year":2023},"citing_paper":{"arxiv_id":"2504.16368","last_updated":"2025-04-23T02:41:43Z","snapshot_observed_at":"2026-08-18T14:57:39.061247Z","submitted_at":"2025-04-23T02:41:43Z","title":"Revisiting Radar Camera Alignment by Contrastive Learning for 3D Object Detection","version":1},"reference_index":48,"source":"pdf_text","source_observed_at":"2026-08-16T11:10:11.916829Z"},"links":{"citing_paper":"/paper/2504.16368"},"observation_digest":"sha256:714b64388c4c88b94e472dc7ad8151ff5d87467abb1db247fd14e4f197856ec3","observation_id":"97fa5e9f-0a33-4c8a-8f59-8106e64cd1d3","resolution":{"observed_at":"2026-08-16T11:10:12.257281Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T11:10:11.920381Z","title":"nuscenes: A multimodal dataset for autonomous driving,","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2504.16368","last_updated":"2025-04-23T02:41:43Z","snapshot_observed_at":"2026-08-18T14:57:39.061247Z","submitted_at":"2025-04-23T02:41:43Z","title":"Revisiting Radar Camera Alignment by Contrastive Learning for 3D Object Detection","version":1},"reference_index":49,"source":"pdf_text","source_observed_at":"2026-08-16T11:10:11.920381Z"},"links":{"citing_paper":"/paper/2504.16368"},"observation_digest":"sha256:09c724046e8df8d00eb82fed308afd1f76dcaa7b614170044ed4f455ac5ff18c","observation_id":"22553127-57c5-4e13-bce9-e23387960a83","resolution":{"observed_at":"2026-08-16T11:10:11.920381Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T11:10:11.923971Z","title":"Deep residual learning for image recognition,","venue":null,"work_id":null,"year":2016},"citing_paper":{"arxiv_id":"2504.16368","last_updated":"2025-04-23T02:41:43Z","snapshot_observed_at":"2026-08-18T14:57:39.061247Z","submitted_at":"2025-04-23T02:41:43Z","title":"Revisiting Radar Camera Alignment by Contrastive Learning for 3D Object Detection","version":1},"reference_index":50,"source":"pdf_text","source_observed_at":"2026-08-16T11:10:11.923971Z"},"links":{"citing_paper":"/paper/2504.16368"},"observation_digest":"sha256:e2877e3d683827397a3816ffb744d03c4357b3d0b65ac371b00dac376975794e","observation_id":"45cfbb37-0d35-4652-8f69-02543c9adcc3","resolution":{"observed_at":"2026-08-16T11:10:11.923971Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T11:10:12.223575Z","title":"An energy and gpu- computation efficient backbone network for real-time object detection,","venue":null,"work_id":"d21b7e86-5d24-4835-b0b4-2619a802318d","year":2019},"citing_paper":{"arxiv_id":"2504.16368","last_updated":"2025-04-23T02:41:43Z","snapshot_observed_at":"2026-08-18T14:57:39.061247Z","submitted_at":"2025-04-23T02:41:43Z","title":"Revisiting Radar Camera Alignment by Contrastive Learning for 3D Object Detection","version":1},"reference_index":51,"source":"pdf_text","source_observed_at":"2026-08-16T11:10:11.928187Z"},"links":{"citing_paper":"/paper/2504.16368"},"observation_digest":"sha256:a87f5804d1015896625aabbcfcd969b194e3a171c5a70b842704fa5a17c6eec6","observation_id":"a7c59733-f344-4c03-b033-e6aed0b003d3","resolution":{"observed_at":"2026-08-16T11:10:12.227397Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T11:10:11.933101Z","title":"Imagenet: A large-scale hierarchical image database,","venue":null,"work_id":null,"year":2009},"citing_paper":{"arxiv_id":"2504.16368","last_updated":"2025-04-23T02:41:43Z","snapshot_observed_at":"2026-08-18T14:57:39.061247Z","submitted_at":"2025-04-23T02:41:43Z","title":"Revisiting Radar Camera Alignment by Contrastive Learning for 3D Object Detection","version":1},"reference_index":52,"source":"pdf_text","source_observed_at":"2026-08-16T11:10:11.933101Z"},"links":{"citing_paper":"/paper/2504.16368"},"observation_digest":"sha256:14d6c8d86b55d4fae759835bda44e85f70a5d0f740ce35f468e23b2f698f2cc4","observation_id":"6698b2b1-8a88-4070-bd9e-c825795bf7c0","resolution":{"observed_at":"2026-08-16T11:10:11.933101Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T11:10:11.937587Z","title":"Is pseudo- lidar needed for monocular 3d object detection?","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2504.16368","last_updated":"2025-04-23T02:41:43Z","snapshot_observed_at":"2026-08-18T14:57:39.061247Z","submitted_at":"2025-04-23T02:41:43Z","title":"Revisiting Radar Camera Alignment by Contrastive Learning for 3D Object Detection","version":1},"reference_index":53,"source":"pdf_text","source_observed_at":"2026-08-16T11:10:11.937587Z"},"links":{"citing_paper":"/paper/2504.16368"},"observation_digest":"sha256:27d3ec29dd4b5709581872d1534b09cc5e69f87794f31059e8e0ffdf6b84a6ec","observation_id":"b6aeab33-294a-443a-bcef-fe9d9739e38b","resolution":{"observed_at":"2026-08-16T11:10:11.937587Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T11:10:12.193159Z","title":"Focal-petr: Embracing foreground for efficient multi-camera 3d object detection,","venue":null,"work_id":"2fc17838-4ccf-4f99-8d94-38437b120c32","year":2023},"citing_paper":{"arxiv_id":"2504.16368","last_updated":"2025-04-23T02:41:43Z","snapshot_observed_at":"2026-08-18T14:57:39.061247Z","submitted_at":"2025-04-23T02:41:43Z","title":"Revisiting Radar Camera Alignment by Contrastive Learning for 3D Object Detection","version":1},"reference_index":54,"source":"pdf_text","source_observed_at":"2026-08-16T11:10:11.941580Z"},"links":{"citing_paper":"/paper/2504.16368"},"observation_digest":"sha256:72877a8f4ef5b6c1e7a257fd0866ef7365c6b8cd3a8d1cf78b42369b65b16468","observation_id":"e40ee12f-838c-4d7e-9823-c684c9be94e0","resolution":{"observed_at":"2026-08-16T11:10:12.197756Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T11:10:11.945629Z","title":"Dn-detr: Accelerate detr training by introducing query denoising,","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2504.16368","last_updated":"2025-04-23T02:41:43Z","snapshot_observed_at":"2026-08-18T14:57:39.061247Z","submitted_at":"2025-04-23T02:41:43Z","title":"Revisiting Radar Camera Alignment by Contrastive Learning for 3D Object Detection","version":1},"reference_index":55,"source":"pdf_text","source_observed_at":"2026-08-16T11:10:11.945629Z"},"links":{"citing_paper":"/paper/2504.16368"},"observation_digest":"sha256:f76fb9a7e72644c05609c144b58935bbbfd0ad0e296d42440e3b2d7ffc6a5c37","observation_id":"ecc60190-563f-4c4b-98ad-9155e95c3a88","resolution":{"observed_at":"2026-08-16T11:10:11.945629Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1908.09492","last_updated":"2019-08-26T06:27:01Z","snapshot_observed_at":"2026-08-14T21:44:27.735473Z","submitted_at":"2019-08-26T06:27:01Z","title":"Class-balanced Grouping and Sampling for Point Cloud 3D Object Detection","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1908.09492","snapshot_observed_at":"2026-08-16T11:10:11.949681Z","title":"Class-balanced grouping and sampling for point cloud 3d object detection,","venue":null,"work_id":null,"year":1908},"citing_paper":{"arxiv_id":"2504.16368","last_updated":"2025-04-23T02:41:43Z","snapshot_observed_at":"2026-08-18T14:57:39.061247Z","submitted_at":"2025-04-23T02:41:43Z","title":"Revisiting Radar Camera Alignment by Contrastive Learning for 3D Object Detection","version":1},"reference_index":56,"source":"pdf_text","source_observed_at":"2026-08-16T11:10:11.949681Z"},"links":{"cited_paper":"/paper/1908.09492","citing_paper":"/paper/2504.16368"},"observation_digest":"sha256:6f29720585d9222aa27f15c423b751ac65a944e47510d1d50fb027b5060f785d","observation_id":"c9189eca-c5f8-450d-8e2d-0d89e4142ecd","resolution":{"observed_at":"2026-08-16T11:10:11.949681Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1711.05101","last_updated":"2019-01-04T21:01:49Z","snapshot_observed_at":"2026-08-14T20:13:52.872565Z","submitted_at":"2017-11-14T14:24:06Z","title":"Decoupled Weight Decay Regularization","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1711.05101","snapshot_observed_at":"2026-08-16T11:10:11.954037Z","title":"Decoupled weight decay regularization,","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2504.16368","last_updated":"2025-04-23T02:41:43Z","snapshot_observed_at":"2026-08-18T14:57:39.061247Z","submitted_at":"2025-04-23T02:41:43Z","title":"Revisiting Radar Camera Alignment by Contrastive Learning for 3D Object Detection","version":1},"reference_index":57,"source":"pdf_text","source_observed_at":"2026-08-16T11:10:11.954037Z"},"links":{"cited_paper":"/paper/1711.05101","citing_paper":"/paper/2504.16368"},"observation_digest":"sha256:12715a38e60670aafdea12e18180048706f5e95915d9a7acde71d37b856b9a70","observation_id":"6c2e6a38-efa6-472e-b5ae-57642558e37a","resolution":{"observed_at":"2026-08-16T11:10:11.954037Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T11:10:11.958270Z","title":"Petrv2: A unified framework for 3d perception from multi-camera images,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2504.16368","last_updated":"2025-04-23T02:41:43Z","snapshot_observed_at":"2026-08-18T14:57:39.061247Z","submitted_at":"2025-04-23T02:41:43Z","title":"Revisiting Radar Camera Alignment by Contrastive Learning for 3D Object Detection","version":1},"reference_index":58,"source":"pdf_text","source_observed_at":"2026-08-16T11:10:11.958270Z"},"links":{"citing_paper":"/paper/2504.16368"},"observation_digest":"sha256:7ed631a718ab686a27c4e091a397deeb44a4d9c88cc0d9c70a7f7bdbc777a840","observation_id":"c7c6a263-05d9-47b8-857a-042d36ab2f78","resolution":{"observed_at":"2026-08-16T11:10:11.958270Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T11:10:12.159369Z","title":"Unifying voxel- based representation with transformer for 3d object detection,","venue":null,"work_id":"22d1b057-d1dc-46ea-b98a-7f3e72d3e787","year":2022},"citing_paper":{"arxiv_id":"2504.16368","last_updated":"2025-04-23T02:41:43Z","snapshot_observed_at":"2026-08-18T14:57:39.061247Z","submitted_at":"2025-04-23T02:41:43Z","title":"Revisiting Radar Camera Alignment by Contrastive Learning for 3D Object Detection","version":1},"reference_index":59,"source":"pdf_text","source_observed_at":"2026-08-16T11:10:11.961752Z"},"links":{"citing_paper":"/paper/2504.16368"},"observation_digest":"sha256:16ca05de537767c6eaedab8cf9f88a52f9fd511bceaa5d2938c381b7f6326b6e","observation_id":"7e26c791-4f02-4395-ac92-0e9dc6bb71b7","resolution":{"observed_at":"2026-08-16T11:10:12.165825Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T11:10:11.965820Z","title":"Pointnet++: Deep hierarchical feature learning on point sets in a metric space,","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2504.16368","last_updated":"2025-04-23T02:41:43Z","snapshot_observed_at":"2026-08-18T14:57:39.061247Z","submitted_at":"2025-04-23T02:41:43Z","title":"Revisiting Radar Camera Alignment by Contrastive Learning for 3D Object Detection","version":1},"reference_index":60,"source":"pdf_text","source_observed_at":"2026-08-16T11:10:11.965820Z"},"links":{"citing_paper":"/paper/2504.16368"},"observation_digest":"sha256:2b44d30326bc3c8e5fb426f2ebd6060cf89c17775c7ce96bd7452ebc0f262b54","observation_id":"6f094a08-0a12-49a8-b5b9-11bbd630bd1b","resolution":{"observed_at":"2026-08-16T11:10:11.965820Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"paper":{"arxiv_id":"2504.16368","last_updated":"2025-04-23T02:41:43Z","latest_version":1,"primary_category":"cs.CV","snapshot_observed_at":"2026-08-18T14:57:39.061247Z","submitted_at":"2025-04-23T02:41:43Z","title":"Revisiting Radar Camera Alignment by Contrastive Learning for 3D Object Detection"},"reference_resolution":{"displayed":60,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":39,"verified_exact":0,"verified_fuzzy":21},"total_outbound_references":60},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"thesis":"As of 18 August 2026, this Paper Citation Record lists 60 of 60 outbound references and 0 inbound Pith citation observations for arXiv:2504.16368."}