{"as_of":"2026-08-16T21:50:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:db0dc57fe8c5573f05390f2ae714e4c473058905eabeaec1a0fab88f1f835111","coverage":[{"denominator":300,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":100,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-15T16:56:45.940439Z","state":"measured"},{"denominator":100,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":100,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-16T06:30:59.297886+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2508.19593/citation-record","integrity":"/paper/2508.19593/integrity","json":"/paper/2508.19593/citation-record.json","paper":"/paper/2508.19593"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T16:56:45.522176Z","title":"http://www.cvlibs.net/datasets/kitti/eval_object.php? obj_benchmark=3d","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2508.19593","last_updated":"2025-08-27T06:06:18Z","snapshot_observed_at":"2026-08-16T12:37:30.146432Z","submitted_at":"2025-08-27T06:06:18Z","title":"Generalizing Monocular 3D Object Detection","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-15T16:56:45.522176Z"},"links":{"citing_paper":"/paper/2508.19593"},"observation_digest":"sha256:1b16321a2846160be39263da23ab7b9bb0c89439cf8a5ef9f1f1f36b7cd19851","observation_id":"0023e98d-1609-48cb-ae04-3331bcf748d1","resolution":{"observed_at":"2026-08-15T16:56:45.522176Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T16:56:45.528794Z","title":"Augmentedrealitymeetscomputervision: Efficientdatagenerationforurbandrivingscenes","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2508.19593","last_updated":"2025-08-27T06:06:18Z","snapshot_observed_at":"2026-08-16T12:37:30.146432Z","submitted_at":"2025-08-27T06:06:18Z","title":"Generalizing Monocular 3D Object Detection","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-15T16:56:45.528794Z"},"links":{"citing_paper":"/paper/2508.19593"},"observation_digest":"sha256:09c33c35add6af4eecf9bf2bee4d655c923943210f028eb876a91a9da4c46b0e","observation_id":"4da58671-c078-4769-958e-981511608947","resolution":{"observed_at":"2026-08-15T16:56:45.528794Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T16:56:45.536710Z","title":"Learningdetectionwithdiverseproposals","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2508.19593","last_updated":"2025-08-27T06:06:18Z","snapshot_observed_at":"2026-08-16T12:37:30.146432Z","submitted_at":"2025-08-27T06:06:18Z","title":"Generalizing Monocular 3D Object Detection","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-15T16:56:45.536710Z"},"links":{"citing_paper":"/paper/2508.19593"},"observation_digest":"sha256:0db6e067ab2e487387a9b702ba2f0523f0c1425249aa2389b410fff752bc2d04","observation_id":"92d957ec-6aac-4912-b885-ba4b87f27b68","resolution":{"observed_at":"2026-08-15T16:56:45.536710Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2407.12781","last_updated":"2025-03-22T15:40:42Z","snapshot_observed_at":"2026-08-16T13:33:20.081263Z","submitted_at":"2024-07-17T17:59:05Z","title":"VD3D: Taming Large Video Diffusion Transformers for 3D Camera Control","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2407.12781","snapshot_observed_at":"2026-08-15T16:56:45.540994Z","title":"VD3D: Taming large video diffusion transformers for 3D camera control.arXiv preprint arXiv:2407.12781, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2508.19593","last_updated":"2025-08-27T06:06:18Z","snapshot_observed_at":"2026-08-16T12:37:30.146432Z","submitted_at":"2025-08-27T06:06:18Z","title":"Generalizing Monocular 3D Object Detection","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-15T16:56:45.540994Z"},"links":{"cited_paper":"/paper/2407.12781","citing_paper":"/paper/2508.19593"},"observation_digest":"sha256:9173dbaa5ea5b0c9a38716c4087ad3fe512c5e5a2cfb0617a86f3c5f8e9a237a","observation_id":"17093077-e287-4242-b0b0-ebbe2b100c9f","resolution":{"observed_at":"2026-08-15T16:56:45.540994Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T16:56:45.545398Z","title":"MonoFENet: Monocular3D object detection with feature enhancement networks.IEEE Transactions on Image Processing, 2019","venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2508.19593","last_updated":"2025-08-27T06:06:18Z","snapshot_observed_at":"2026-08-16T12:37:30.146432Z","submitted_at":"2025-08-27T06:06:18Z","title":"Generalizing Monocular 3D Object Detection","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-15T16:56:45.545398Z"},"links":{"citing_paper":"/paper/2508.19593"},"observation_digest":"sha256:91e0c7258fee7bd7d90bacd420da5d0bd7e628bf1e0e117d4834326cc6bfa4f0","observation_id":"b20655a9-4c02-4e4f-92ba-e6c1c0bb34de","resolution":{"observed_at":"2026-08-15T16:56:45.545398Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T16:56:45.549785Z","title":"SemanticKITTI: A dataset for semantic scene understanding of LiDAR sequences","venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2508.19593","last_updated":"2025-08-27T06:06:18Z","snapshot_observed_at":"2026-08-16T12:37:30.146432Z","submitted_at":"2025-08-27T06:06:18Z","title":"Generalizing Monocular 3D Object Detection","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-15T16:56:45.549785Z"},"links":{"citing_paper":"/paper/2508.19593"},"observation_digest":"sha256:c0155a6ce56704fd54d3ab19f4bbd654f055aa0158894633fba78516f558bce1","observation_id":"b55ff6da-8ed7-49f9-a09b-93f3e6f5d02c","resolution":{"observed_at":"2026-08-15T16:56:45.549785Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T16:56:45.553918Z","title":"Monocular differentiable rendering for self-supervised3D object detection","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2508.19593","last_updated":"2025-08-27T06:06:18Z","snapshot_observed_at":"2026-08-16T12:37:30.146432Z","submitted_at":"2025-08-27T06:06:18Z","title":"Generalizing Monocular 3D Object Detection","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-15T16:56:45.553918Z"},"links":{"citing_paper":"/paper/2508.19593"},"observation_digest":"sha256:898aaeb93914ffc3beaf7c5b66c6787ca2ee8ce955b9e84650b19cad22831504","observation_id":"83110045-b69c-46c2-ba2d-22cac73271f0","resolution":{"observed_at":"2026-08-15T16:56:45.553918Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T16:56:45.560593Z","title":"Learning with differentiable perturbed optimizers","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2508.19593","last_updated":"2025-08-27T06:06:18Z","snapshot_observed_at":"2026-08-16T12:37:30.146432Z","submitted_at":"2025-08-27T06:06:18Z","title":"Generalizing Monocular 3D Object Detection","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-15T16:56:45.560593Z"},"links":{"citing_paper":"/paper/2508.19593"},"observation_digest":"sha256:e2008d46d9ec336f73266bd891c74239118604f53d32bb0db9e55633368d4114","observation_id":"31306a7c-5d34-4dbe-9ddc-1477a5ac95fa","resolution":{"observed_at":"2026-08-15T16:56:45.560593Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T16:56:45.564714Z","title":"An inequality for Mill’s ratio.The Annals of Mathematical Statistics,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2508.19593","last_updated":"2025-08-27T06:06:18Z","snapshot_observed_at":"2026-08-16T12:37:30.146432Z","submitted_at":"2025-08-27T06:06:18Z","title":"Generalizing Monocular 3D Object Detection","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-15T16:56:45.564714Z"},"links":{"citing_paper":"/paper/2508.19593"},"observation_digest":"sha256:3ca719c02ff038a0d805869fab1eb6c632052d94e190fadaf2d211e076f04496","observation_id":"8f1f1a19-fabf-461a-9210-20cc77093e85","resolution":{"observed_at":"2026-08-15T16:56:45.564714Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T16:56:45.569615Z","title":"Fast differentiable sorting and ranking","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2508.19593","last_updated":"2025-08-27T06:06:18Z","snapshot_observed_at":"2026-08-16T12:37:30.146432Z","submitted_at":"2025-08-27T06:06:18Z","title":"Generalizing Monocular 3D Object Detection","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-15T16:56:45.569615Z"},"links":{"citing_paper":"/paper/2508.19593"},"observation_digest":"sha256:9d961ebf642de2e15abb294f9644b2abf23bc97e7c5f21bf52a6b130757eecf0","observation_id":"6646b1e8-2efc-4f9c-be78-858a19a71b72","resolution":{"observed_at":"2026-08-15T16:56:45.569615Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2004.10934","last_updated":"2020-04-23T02:10:02Z","snapshot_observed_at":"2026-08-16T04:20:57.069798Z","submitted_at":"2020-04-23T02:10:02Z","title":"YOLOv4: Optimal Speed and Accuracy of Object Detection","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2004.10934","snapshot_observed_at":"2026-08-15T16:56:45.573780Z","title":"YOLOv4: Optimal speed and accuracy of object detection.arXiv preprint arXiv:2004.10934, 2020","venue":null,"work_id":null,"year":2004},"citing_paper":{"arxiv_id":"2508.19593","last_updated":"2025-08-27T06:06:18Z","snapshot_observed_at":"2026-08-16T12:37:30.146432Z","submitted_at":"2025-08-27T06:06:18Z","title":"Generalizing Monocular 3D Object Detection","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-15T16:56:45.573780Z"},"links":{"cited_paper":"/paper/2004.10934","citing_paper":"/paper/2508.19593"},"observation_digest":"sha256:50d7fd8024ff5e542dc2940d864a4d76d6d2d2211dc05e5b3da72bcc10f30394","observation_id":"fd094294-ce06-4b7a-847b-5639a252f8d1","resolution":{"observed_at":"2026-08-15T16:56:45.573780Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T16:56:45.578309Z","title":"Soft-NMS–improving object detection with one line of code","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2508.19593","last_updated":"2025-08-27T06:06:18Z","snapshot_observed_at":"2026-08-16T12:37:30.146432Z","submitted_at":"2025-08-27T06:06:18Z","title":"Generalizing Monocular 3D Object Detection","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-15T16:56:45.578309Z"},"links":{"citing_paper":"/paper/2508.19593"},"observation_digest":"sha256:a547b5ffe1a5018f1f9d395d2d5019e7862413177f4072c6712f0307e470c21a","observation_id":"66fdfb8a-ba95-4b05-84ba-b95ce6a24b38","resolution":{"observed_at":"2026-08-15T16:56:45.578309Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T16:56:45.583474Z","title":"Soft-NMSimplementa- tion","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2508.19593","last_updated":"2025-08-27T06:06:18Z","snapshot_observed_at":"2026-08-16T12:37:30.146432Z","submitted_at":"2025-08-27T06:06:18Z","title":"Generalizing Monocular 3D Object Detection","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-15T16:56:45.583474Z"},"links":{"citing_paper":"/paper/2508.19593"},"observation_digest":"sha256:154dcce18730cb83b9e437979396ba4679d1736a841b231d9a44c9f3ae1ec529","observation_id":"d73c2ef1-ca77-4f23-a943-4fc2c1fd627c","resolution":{"observed_at":"2026-08-15T16:56:45.583474Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T16:56:45.595768Z","title":"Omni3D: A large benchmark and model for3D object detection in the wild","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2508.19593","last_updated":"2025-08-27T06:06:18Z","snapshot_observed_at":"2026-08-16T12:37:30.146432Z","submitted_at":"2025-08-27T06:06:18Z","title":"Generalizing Monocular 3D Object Detection","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-15T16:56:45.595768Z"},"links":{"citing_paper":"/paper/2508.19593"},"observation_digest":"sha256:af2d2cc3cc8943b97a42955f816d1127eb190b8d19c27aa497f049b455634738","observation_id":"104d9128-7471-4b6a-9820-4164f1329948","resolution":{"observed_at":"2026-08-15T16:56:45.595768Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T16:56:45.600473Z","title":"M3D-RPN: Monocular3D region proposal network for object detection","venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2508.19593","last_updated":"2025-08-27T06:06:18Z","snapshot_observed_at":"2026-08-16T12:37:30.146432Z","submitted_at":"2025-08-27T06:06:18Z","title":"Generalizing Monocular 3D Object Detection","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-15T16:56:45.600473Z"},"links":{"citing_paper":"/paper/2508.19593"},"observation_digest":"sha256:c169294292945d898800faba63414e907134a93a443f4c1308b99590cde4c83d","observation_id":"9a6a7c09-bb65-40a8-b3e7-4b23fa402dc0","resolution":{"observed_at":"2026-08-15T16:56:45.600473Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T16:56:45.604687Z","title":"Pedestriandetectionwithautoregressivenetworkphases","venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2508.19593","last_updated":"2025-08-27T06:06:18Z","snapshot_observed_at":"2026-08-16T12:37:30.146432Z","submitted_at":"2025-08-27T06:06:18Z","title":"Generalizing Monocular 3D Object Detection","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-15T16:56:45.604687Z"},"links":{"citing_paper":"/paper/2508.19593"},"observation_digest":"sha256:b3259551efa2326f85fd9e5ee923f3215cc183c538e22572d2d9c9e103a52b15","observation_id":"f042fba5-5961-4fbc-a876-7b04aa952fd0","resolution":{"observed_at":"2026-08-15T16:56:45.604687Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T16:56:45.608496Z","title":"Kinematic3D object detectioninmonocularvideo","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2508.19593","last_updated":"2025-08-27T06:06:18Z","snapshot_observed_at":"2026-08-16T12:37:30.146432Z","submitted_at":"2025-08-27T06:06:18Z","title":"Generalizing Monocular 3D Object Detection","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-15T16:56:45.608496Z"},"links":{"citing_paper":"/paper/2508.19593"},"observation_digest":"sha256:2aea557b802116d58b6872b0b9ef6ba85193d257b46398cdf704f87cd5a2cb3b","observation_id":"6f9967a6-9200-41ae-a200-b673ade73999","resolution":{"observed_at":"2026-08-15T16:56:45.608496Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T16:56:45.612691Z","title":"Illuminating pedestrians via simultaneous detection & segmentation","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2508.19593","last_updated":"2025-08-27T06:06:18Z","snapshot_observed_at":"2026-08-16T12:37:30.146432Z","submitted_at":"2025-08-27T06:06:18Z","title":"Generalizing Monocular 3D Object Detection","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-15T16:56:45.612691Z"},"links":{"citing_paper":"/paper/2508.19593"},"observation_digest":"sha256:4454167cdd0c051b80345037ee03564405743c37563a6355db50af422c285e0e","observation_id":"6b4185e8-60d2-4838-a823-162752425d05","resolution":{"observed_at":"2026-08-15T16:56:45.612691Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T16:56:45.616890Z","title":"Convolution from first principles","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2508.19593","last_updated":"2025-08-27T06:06:18Z","snapshot_observed_at":"2026-08-16T12:37:30.146432Z","submitted_at":"2025-08-27T06:06:18Z","title":"Generalizing Monocular 3D Object Detection","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-15T16:56:45.616890Z"},"links":{"citing_paper":"/paper/2508.19593"},"observation_digest":"sha256:eecce0694d908454659d3d9cc99a48b51f51e70540d11a3d32a51e37f9ab6365","observation_id":"66377f09-439c-4887-ac13-4f5d3e9a192e","resolution":{"observed_at":"2026-08-15T16:56:45.616890Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2104.13478","last_updated":"2021-05-02T16:16:03Z","snapshot_observed_at":"2026-08-12T23:06:05.148534Z","submitted_at":"2021-04-27T21:09:51Z","title":"Geometric Deep Learning: Grids, Groups, Graphs, Geodesics, and Gauges","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2104.13478","snapshot_observed_at":"2026-08-15T16:56:45.620760Z","title":"Geometricdeeplearning: Grids, groups, graphs, geodesics, and gauges.arXiv preprint arXiv:2104.13478, 2021","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2508.19593","last_updated":"2025-08-27T06:06:18Z","snapshot_observed_at":"2026-08-16T12:37:30.146432Z","submitted_at":"2025-08-27T06:06:18Z","title":"Generalizing Monocular 3D Object Detection","version":1},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-15T16:56:45.620760Z"},"links":{"cited_paper":"/paper/2104.13478","citing_paper":"/paper/2508.19593"},"observation_digest":"sha256:36ec02ebd8bcc269c19f2633c21d1e60b875b10612e43960d65565afac0bf0a2","observation_id":"90f18c77-8708-4f9e-aab2-2f33362eb4d9","resolution":{"observed_at":"2026-08-15T16:56:45.620760Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T16:56:45.625021Z","title":"The non-existence of general-case view-invariants","venue":null,"work_id":null,"year":1992},"citing_paper":{"arxiv_id":"2508.19593","last_updated":"2025-08-27T06:06:18Z","snapshot_observed_at":"2026-08-16T12:37:30.146432Z","submitted_at":"2025-08-27T06:06:18Z","title":"Generalizing Monocular 3D Object Detection","version":1},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-15T16:56:45.625021Z"},"links":{"citing_paper":"/paper/2508.19593"},"observation_digest":"sha256:c4590e8e55dacc44961ea7a87e4579c0a1d5825ce1fe83812866ce624a70ef3f","observation_id":"40816baf-05b6-40ce-8329-027e231a12c8","resolution":{"observed_at":"2026-08-15T16:56:45.625021Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T16:56:45.628976Z","title":"nuScenes: A multimodal dataset for autonomous driving","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2508.19593","last_updated":"2025-08-27T06:06:18Z","snapshot_observed_at":"2026-08-16T12:37:30.146432Z","submitted_at":"2025-08-27T06:06:18Z","title":"Generalizing Monocular 3D Object Detection","version":1},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-15T16:56:45.628976Z"},"links":{"citing_paper":"/paper/2508.19593"},"observation_digest":"sha256:553c8bd4d1dd6ea9ce74d0c446914507cc3ee67ad55efa03c88a9ff55f16740a","observation_id":"9ca668fc-ea6b-47ad-83b0-f571309969cb","resolution":{"observed_at":"2026-08-15T16:56:45.628976Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T16:56:45.632488Z","title":"2 die when tesla crashes into parked tractor-trailer in florida","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2508.19593","last_updated":"2025-08-27T06:06:18Z","snapshot_observed_at":"2026-08-16T12:37:30.146432Z","submitted_at":"2025-08-27T06:06:18Z","title":"Generalizing Monocular 3D Object Detection","version":1},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-15T16:56:45.632488Z"},"links":{"citing_paper":"/paper/2508.19593"},"observation_digest":"sha256:f35b4666cdd03f6253aeeb5848acd867842f0204bbf6370edd4f5aff2a07c182","observation_id":"a0298d51-b210-4b0e-be63-c6b556f14fe9","resolution":{"observed_at":"2026-08-15T16:56:45.632488Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T16:56:45.636293Z","title":"End-to-endobjectdetectionwithtransformers","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2508.19593","last_updated":"2025-08-27T06:06:18Z","snapshot_observed_at":"2026-08-16T12:37:30.146432Z","submitted_at":"2025-08-27T06:06:18Z","title":"Generalizing Monocular 3D Object Detection","version":1},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-15T16:56:45.636293Z"},"links":{"citing_paper":"/paper/2508.19593"},"observation_digest":"sha256:0ffdb5da23a910865d0dbf3b6a06a2ac1b42c9efc73e173444e0987d6b1d16e2","observation_id":"4d3ded41-75c3-4105-bc12-ce7343c7fb99","resolution":{"observed_at":"2026-08-15T16:56:45.636293Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T16:56:45.640266Z","title":"Deep MANTA: A coarse-to-fine many-task network for joint2D and 3D vehi- cle analysis from monocular image","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2508.19593","last_updated":"2025-08-27T06:06:18Z","snapshot_observed_at":"2026-08-16T12:37:30.146432Z","submitted_at":"2025-08-27T06:06:18Z","title":"Generalizing Monocular 3D Object Detection","version":1},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-08-15T16:56:45.640266Z"},"links":{"citing_paper":"/paper/2508.19593"},"observation_digest":"sha256:c6e8f078ad39ec8ee041caec9a662abba093dc0c15aa04d255a5324079e3d2b6","observation_id":"24254ba2-ff0a-4b7a-b2bc-15113f52781e","resolution":{"observed_at":"2026-08-15T16:56:45.640266Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T16:56:45.647669Z","title":"Unified domain generalization and adaptation for multi-view3D 81 object detection","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2508.19593","last_updated":"2025-08-27T06:06:18Z","snapshot_observed_at":"2026-08-16T12:37:30.146432Z","submitted_at":"2025-08-27T06:06:18Z","title":"Generalizing Monocular 3D Object Detection","version":1},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-08-15T16:56:45.647669Z"},"links":{"citing_paper":"/paper/2508.19593"},"observation_digest":"sha256:d5e824aa0b8e7e85b8506b83cb9c40cff90440ec03940268d1e241a770f73eb9","observation_id":"591364f5-f662-4b19-95de-9e5c98fd15ac","resolution":{"observed_at":"2026-08-15T16:56:45.647669Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T16:56:45.652307Z","title":"CMDA: Cross-modal and domain adversarial adaptation for LiDAR-based3D object detection","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2508.19593","last_updated":"2025-08-27T06:06:18Z","snapshot_observed_at":"2026-08-16T12:37:30.146432Z","submitted_at":"2025-08-27T06:06:18Z","title":"Generalizing Monocular 3D Object Detection","version":1},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-08-15T16:56:45.652307Z"},"links":{"citing_paper":"/paper/2508.19593"},"observation_digest":"sha256:94a9a3a0367d8f0f0d8fc64cd03e86682741d6262803a2d462de5ba9eb75264c","observation_id":"e7f2cbe4-2f46-41cb-9aa8-4191900911c6","resolution":{"observed_at":"2026-08-15T16:56:45.652307Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T16:56:45.656640Z","title":"RecurrentBEV: A long-term temporal fusion framework for multi-view3D detection","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2508.19593","last_updated":"2025-08-27T06:06:18Z","snapshot_observed_at":"2026-08-16T12:37:30.146432Z","submitted_at":"2025-08-27T06:06:18Z","title":"Generalizing Monocular 3D Object Detection","version":1},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-08-15T16:56:45.656640Z"},"links":{"citing_paper":"/paper/2508.19593"},"observation_digest":"sha256:76b2133e509021b59c94401985b55de9cb24e6c7bcfe91806162180eecd934a6","observation_id":"6f805356-5393-4cf4-8874-50868897851d","resolution":{"observed_at":"2026-08-15T16:56:45.656640Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T16:56:45.663035Z","title":"Viewpoint equivariance for multi-view3D object detection","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2508.19593","last_updated":"2025-08-27T06:06:18Z","snapshot_observed_at":"2026-08-16T12:37:30.146432Z","submitted_at":"2025-08-27T06:06:18Z","title":"Generalizing Monocular 3D Object Detection","version":1},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-08-15T16:56:45.663035Z"},"links":{"citing_paper":"/paper/2508.19593"},"observation_digest":"sha256:21602a31686432dfe5ef3c1e36178f608dd7af98eb43eba111777c81aee72153","observation_id":"7e45ce87-f8d8-4a60-95b1-42656a52a39b","resolution":{"observed_at":"2026-08-15T16:56:45.663035Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T16:56:45.668359Z","title":"AP-Lossforaccurate one-stage object detection.TPAMI, 2020","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2508.19593","last_updated":"2025-08-27T06:06:18Z","snapshot_observed_at":"2026-08-16T12:37:30.146432Z","submitted_at":"2025-08-27T06:06:18Z","title":"Generalizing Monocular 3D Object Detection","version":1},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-08-15T16:56:45.668359Z"},"links":{"citing_paper":"/paper/2508.19593"},"observation_digest":"sha256:5284dac3e014eb6315150327ec9178f767a757370d5a34024f7ab7be54be878b","observation_id":"ebacaf2b-39af-4a16-97b8-eccb0342324f","resolution":{"observed_at":"2026-08-15T16:56:45.668359Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T16:56:45.672162Z","title":"Monocular 3D object detection for autonomous driving","venue":null,"work_id":null,"year":2016},"citing_paper":{"arxiv_id":"2508.19593","last_updated":"2025-08-27T06:06:18Z","snapshot_observed_at":"2026-08-16T12:37:30.146432Z","submitted_at":"2025-08-27T06:06:18Z","title":"Generalizing Monocular 3D Object Detection","version":1},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-08-15T16:56:45.672162Z"},"links":{"citing_paper":"/paper/2508.19593"},"observation_digest":"sha256:a8b9c72880cca75d21ea5ec1caa2d6b2f6f227e0706610fd518fda3550296087","observation_id":"ceecd3d2-2f44-4ab7-b32c-40e1169fdcda","resolution":{"observed_at":"2026-08-15T16:56:45.672162Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T16:56:45.676597Z","title":"InNeurIPS,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2508.19593","last_updated":"2025-08-27T06:06:18Z","snapshot_observed_at":"2026-08-16T12:37:30.146432Z","submitted_at":"2025-08-27T06:06:18Z","title":"Generalizing Monocular 3D Object Detection","version":1},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-08-15T16:56:45.676597Z"},"links":{"citing_paper":"/paper/2508.19593"},"observation_digest":"sha256:d18547973fb21110261080a2b566112d879a56d91c31ababd9df58550f9d0eb8","observation_id":"5a1debf9-9565-4a16-8e87-914354d80801","resolution":{"observed_at":"2026-08-15T16:56:45.676597Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T16:56:45.680849Z","title":"Multi-view3D object detection network for autonomous driving","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2508.19593","last_updated":"2025-08-27T06:06:18Z","snapshot_observed_at":"2026-08-16T12:37:30.146432Z","submitted_at":"2025-08-27T06:06:18Z","title":"Generalizing Monocular 3D Object Detection","version":1},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-08-15T16:56:45.680849Z"},"links":{"citing_paper":"/paper/2508.19593"},"observation_digest":"sha256:3f7302e215352181be7f4d3d42d6bd9e9ab357dd8e6a99d30abcb385ffbeec72","observation_id":"35cda1f6-6894-4a83-b98b-147012b83f43","resolution":{"observed_at":"2026-08-15T16:56:45.680849Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T16:56:45.684801Z","title":"DSGN: Deep stereo geometry network for 3D object detection","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2508.19593","last_updated":"2025-08-27T06:06:18Z","snapshot_observed_at":"2026-08-16T12:37:30.146432Z","submitted_at":"2025-08-27T06:06:18Z","title":"Generalizing Monocular 3D Object Detection","version":1},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-08-15T16:56:45.684801Z"},"links":{"citing_paper":"/paper/2508.19593"},"observation_digest":"sha256:6b879f37b08cd45c863bcf886731ec6881adfc02a51c699ca2bf4ae449e482df","observation_id":"719a152c-0ef6-4ceb-ade2-4fddb9a3c509","resolution":{"observed_at":"2026-08-15T16:56:45.684801Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T16:56:45.688625Z","title":"MonoPair: Monocular 3D object detection using pairwise spatial relationships","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2508.19593","last_updated":"2025-08-27T06:06:18Z","snapshot_observed_at":"2026-08-16T12:37:30.146432Z","submitted_at":"2025-08-27T06:06:18Z","title":"Generalizing Monocular 3D Object Detection","version":1},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-08-15T16:56:45.688625Z"},"links":{"citing_paper":"/paper/2508.19593"},"observation_digest":"sha256:101a51c1ad44cf88487e40a4db6991108930dc46ad5e89dc3e11462c9d07cd53","observation_id":"5b73a95a-3aa2-4a3c-a109-1a5a9933e2ee","resolution":{"observed_at":"2026-08-15T16:56:45.688625Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T16:56:45.692283Z","title":"Learning high-resolution vector representation from multi-camera images for 3D object detection","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2508.19593","last_updated":"2025-08-27T06:06:18Z","snapshot_observed_at":"2026-08-16T12:37:30.146432Z","submitted_at":"2025-08-27T06:06:18Z","title":"Generalizing Monocular 3D Object Detection","version":1},"reference_index":36,"source":"pdf_text","source_observed_at":"2026-08-15T16:56:45.692283Z"},"links":{"citing_paper":"/paper/2508.19593"},"observation_digest":"sha256:dfc8ac5f9c1c7d2d8fa4777b76aa8940aab96708cd586cff1d0ba1041eb6d8bb","observation_id":"d32066cb-daa6-419f-8340-a6fd9ce1053b","resolution":{"observed_at":"2026-08-15T16:56:45.692283Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T16:56:45.697219Z","title":"NEAT: Neural attention fields for end-to-end autonomous driving","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2508.19593","last_updated":"2025-08-27T06:06:18Z","snapshot_observed_at":"2026-08-16T12:37:30.146432Z","submitted_at":"2025-08-27T06:06:18Z","title":"Generalizing Monocular 3D Object Detection","version":1},"reference_index":37,"source":"pdf_text","source_observed_at":"2026-08-15T16:56:45.697219Z"},"links":{"citing_paper":"/paper/2508.19593"},"observation_digest":"sha256:b62e08386e8f44edf1cd8c1f812656492e0f19213557532c8cfd3fbe21e9a8b7","observation_id":"c7f2229b-1ca5-45f4-8828-bbf71c7e51b7","resolution":{"observed_at":"2026-08-15T16:56:45.697219Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T16:56:45.701299Z","title":"Depth-discriminativemetriclearningfor monocular 3D object detection","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2508.19593","last_updated":"2025-08-27T06:06:18Z","snapshot_observed_at":"2026-08-16T12:37:30.146432Z","submitted_at":"2025-08-27T06:06:18Z","title":"Generalizing Monocular 3D Object Detection","version":1},"reference_index":38,"source":"pdf_text","source_observed_at":"2026-08-15T16:56:45.701299Z"},"links":{"citing_paper":"/paper/2508.19593"},"observation_digest":"sha256:9c627c0c3e43fc4b0af6ab0fc36df40810fa8b0203f5ec840b0604ff5a772fd4","observation_id":"da2d4bc6-99ac-415d-9262-c369947f3d80","resolution":{"observed_at":"2026-08-15T16:56:45.701299Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T16:56:45.705468Z","title":"MonoDistill: Learningspatialfeaturesformonocular 3Dobjectdetection","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2508.19593","last_updated":"2025-08-27T06:06:18Z","snapshot_observed_at":"2026-08-16T12:37:30.146432Z","submitted_at":"2025-08-27T06:06:18Z","title":"Generalizing Monocular 3D Object Detection","version":1},"reference_index":39,"source":"pdf_text","source_observed_at":"2026-08-15T16:56:45.705468Z"},"links":{"citing_paper":"/paper/2508.19593"},"observation_digest":"sha256:b88c38b133a30b4010445367ecc9a244b315a1aec6386ca60834287d0692cd6f","observation_id":"641ee501-239c-4df1-833b-34a4da035a75","resolution":{"observed_at":"2026-08-15T16:56:45.705468Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2301.05711","last_updated":"2025-08-30T03:24:40Z","snapshot_observed_at":"2026-08-16T16:02:41.598499Z","submitted_at":"2023-01-13T06:02:31Z","title":"OA-DET3D: Embedding Object Awareness as a General Plug-in for Multi-Camera 3D Object Detection","version":3},"cited_work":{"arxiv_id":"2301.05711","doi":null,"metadata_source":"pith","pith_arxiv_id":"2301.05711","snapshot_observed_at":"2026-08-15T16:56:47.187167Z","title":"OA-DET3D: Embedding Object Awareness as a General Plug-in for Multi-Camera 3D Object Detection","venue":"cs.CV","work_id":"a680b35a-a76b-4c36-ad8d-7433f2cd9541","year":2023},"citing_paper":{"arxiv_id":"2508.19593","last_updated":"2025-08-27T06:06:18Z","snapshot_observed_at":"2026-08-16T12:37:30.146432Z","submitted_at":"2025-08-27T06:06:18Z","title":"Generalizing Monocular 3D Object Detection","version":1},"reference_index":40,"source":"pdf_text","source_observed_at":"2026-08-15T16:56:45.709425Z"},"links":{"cited_paper":"/paper/2301.05711","citing_paper":"/paper/2508.19593"},"observation_digest":"sha256:98e4989b395694b60d8b4b18322776c0a5c74b3bd2ce5f653480b25a35a1ee65","observation_id":"3086c173-60c1-46c4-a144-bdee9429abff","resolution":{"observed_at":"2026-08-15T16:56:47.195168Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T16:56:45.714337Z","title":"Spherical CNNs","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2508.19593","last_updated":"2025-08-27T06:06:18Z","snapshot_observed_at":"2026-08-16T12:37:30.146432Z","submitted_at":"2025-08-27T06:06:18Z","title":"Generalizing Monocular 3D Object Detection","version":1},"reference_index":41,"source":"pdf_text","source_observed_at":"2026-08-15T16:56:45.714337Z"},"links":{"citing_paper":"/paper/2508.19593"},"observation_digest":"sha256:6ca80ec506b9ba95af55b3704df6381ec2be295b580dbbbf7443f2da6406c8f0","observation_id":"a8d043f0-eeef-434f-b6c5-0bd2368a3061","resolution":{"observed_at":"2026-08-15T16:56:45.714337Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T16:56:45.718733Z","title":"Learning the irreducible representations of commutative lie groups","venue":null,"work_id":null,"year":2014},"citing_paper":{"arxiv_id":"2508.19593","last_updated":"2025-08-27T06:06:18Z","snapshot_observed_at":"2026-08-16T12:37:30.146432Z","submitted_at":"2025-08-27T06:06:18Z","title":"Generalizing Monocular 3D Object Detection","version":1},"reference_index":42,"source":"pdf_text","source_observed_at":"2026-08-15T16:56:45.718733Z"},"links":{"citing_paper":"/paper/2508.19593"},"observation_digest":"sha256:f7cabcf1567ddcd7c2fcefb52351ddcdc6934fa5dacd274dd728257f3a3d6782","observation_id":"3fc2cd06-ebb5-426c-9a8e-40992c99a0fe","resolution":{"observed_at":"2026-08-15T16:56:45.718733Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T16:56:45.722976Z","title":"Group equivariant convolutional networks","venue":null,"work_id":null,"year":2016},"citing_paper":{"arxiv_id":"2508.19593","last_updated":"2025-08-27T06:06:18Z","snapshot_observed_at":"2026-08-16T12:37:30.146432Z","submitted_at":"2025-08-27T06:06:18Z","title":"Generalizing Monocular 3D Object Detection","version":1},"reference_index":43,"source":"pdf_text","source_observed_at":"2026-08-15T16:56:45.722976Z"},"links":{"citing_paper":"/paper/2508.19593"},"observation_digest":"sha256:48aadd0bf23ebbce61b641be0f8b61aefebc90f87588bd8cfb3676f0cf809650","observation_id":"905cd0fb-8cb5-4e46-b35d-80da319aed61","resolution":{"observed_at":"2026-08-15T16:56:45.722976Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T16:56:45.726933Z","title":"MMDetection3D: OpenMMLab next-generation platform forgeneral 3Dobjectdetection","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2508.19593","last_updated":"2025-08-27T06:06:18Z","snapshot_observed_at":"2026-08-16T12:37:30.146432Z","submitted_at":"2025-08-27T06:06:18Z","title":"Generalizing Monocular 3D Object Detection","version":1},"reference_index":44,"source":"pdf_text","source_observed_at":"2026-08-15T16:56:45.726933Z"},"links":{"citing_paper":"/paper/2508.19593"},"observation_digest":"sha256:83a5df83a651f8d4b64d496fc9b519faec06eea1ac8c534c99a339854db7e16f","observation_id":"372ea970-0a5c-4d9d-ae12-fffd4f9ab963","resolution":{"observed_at":"2026-08-15T16:56:45.726933Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2009.09796","last_updated":"2020-09-10T19:31:04Z","snapshot_observed_at":"2026-08-09T08:30:49.737024Z","submitted_at":"2020-09-10T19:31:04Z","title":"Multi-Task Learning with Deep Neural Networks: A Survey","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2009.09796","snapshot_observed_at":"2026-08-15T16:56:45.731876Z","title":"Multi-tasklearningwithdeepneuralnetworks: Asurvey","venue":null,"work_id":null,"year":2009},"citing_paper":{"arxiv_id":"2508.19593","last_updated":"2025-08-27T06:06:18Z","snapshot_observed_at":"2026-08-16T12:37:30.146432Z","submitted_at":"2025-08-27T06:06:18Z","title":"Generalizing Monocular 3D Object Detection","version":1},"reference_index":45,"source":"pdf_text","source_observed_at":"2026-08-15T16:56:45.731876Z"},"links":{"cited_paper":"/paper/2009.09796","citing_paper":"/paper/2508.19593"},"observation_digest":"sha256:54cc079487ebf327896ea52af0f5138f955a602d9656158b5410f3683cce9283","observation_id":"97879b9e-ed55-4fb9-ba55-b767c193b876","resolution":{"observed_at":"2026-08-15T16:56:45.731876Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T16:56:45.736143Z","title":"Differentiableranksandsortingusing optimal transport","venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2508.19593","last_updated":"2025-08-27T06:06:18Z","snapshot_observed_at":"2026-08-16T12:37:30.146432Z","submitted_at":"2025-08-27T06:06:18Z","title":"Generalizing Monocular 3D Object Detection","version":1},"reference_index":46,"source":"pdf_text","source_observed_at":"2026-08-15T16:56:45.736143Z"},"links":{"citing_paper":"/paper/2508.19593"},"observation_digest":"sha256:26a4e981180bfd45ceca9063e698c0bf55cb1fa834a39af00be27f5ce33107e6","observation_id":"9b21043b-3e36-41d0-ad9e-53ac20e8c579","resolution":{"observed_at":"2026-08-15T16:56:45.736143Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T16:56:45.741115Z","title":"Histograms of oriented gradients for human detection","venue":null,"work_id":null,"year":2005},"citing_paper":{"arxiv_id":"2508.19593","last_updated":"2025-08-27T06:06:18Z","snapshot_observed_at":"2026-08-16T12:37:30.146432Z","submitted_at":"2025-08-27T06:06:18Z","title":"Generalizing Monocular 3D Object Detection","version":1},"reference_index":47,"source":"pdf_text","source_observed_at":"2026-08-15T16:56:45.741115Z"},"links":{"citing_paper":"/paper/2508.19593"},"observation_digest":"sha256:83d364d25db7b177dc50bf2bd47e6f1a407c08d3fe291517c9eb068bad15f2f0","observation_id":"ff5dc338-7427-4509-8ed8-4799e3ffa1bb","resolution":{"observed_at":"2026-08-15T16:56:45.741115Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T16:56:45.745113Z","title":"ImageNet: A large-scale hierarchical image database","venue":null,"work_id":null,"year":2009},"citing_paper":{"arxiv_id":"2508.19593","last_updated":"2025-08-27T06:06:18Z","snapshot_observed_at":"2026-08-16T12:37:30.146432Z","submitted_at":"2025-08-27T06:06:18Z","title":"Generalizing Monocular 3D Object Detection","version":1},"reference_index":48,"source":"pdf_text","source_observed_at":"2026-08-15T16:56:45.745113Z"},"links":{"citing_paper":"/paper/2508.19593"},"observation_digest":"sha256:24bb31e1061bb0dd4ff953820cef1b39d58c3cb62636609d535b67616f0a2718","observation_id":"7f81a7af-f81a-47b5-aa24-afcdf5c832b9","resolution":{"observed_at":"2026-08-15T16:56:45.745113Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T16:56:45.748796Z","title":"Discriminative models for multi- class object layout.ĲCV, 2011","venue":null,"work_id":null,"year":2011},"citing_paper":{"arxiv_id":"2508.19593","last_updated":"2025-08-27T06:06:18Z","snapshot_observed_at":"2026-08-16T12:37:30.146432Z","submitted_at":"2025-08-27T06:06:18Z","title":"Generalizing Monocular 3D Object Detection","version":1},"reference_index":49,"source":"pdf_text","source_observed_at":"2026-08-15T16:56:45.748796Z"},"links":{"citing_paper":"/paper/2508.19593"},"observation_digest":"sha256:ee2e5c610761d2417f96c4b72934c619d5e5a44c44129e7c2eac3f6dbee0f59d","observation_id":"0cf2d74f-4810-4382-a924-a3e49e4dab54","resolution":{"observed_at":"2026-08-15T16:56:45.748796Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T16:56:45.754004Z","title":"Exploiting cyclic symmetry in convolutional neural networks","venue":null,"work_id":null,"year":2016},"citing_paper":{"arxiv_id":"2508.19593","last_updated":"2025-08-27T06:06:18Z","snapshot_observed_at":"2026-08-16T12:37:30.146432Z","submitted_at":"2025-08-27T06:06:18Z","title":"Generalizing Monocular 3D Object Detection","version":1},"reference_index":50,"source":"pdf_text","source_observed_at":"2026-08-15T16:56:45.754004Z"},"links":{"citing_paper":"/paper/2508.19593"},"observation_digest":"sha256:51f20d6446203edb8bac1c8ca0e00a2c9c878ca0115225d3e447881b8ee4b277","observation_id":"69057f43-8f57-4351-955e-ce0dbc0ac48d","resolution":{"observed_at":"2026-08-15T16:56:45.754004Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T16:56:45.757486Z","title":"Howdoneuralnetworksseedepthinsingleimages? In ICCV, 2019","venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2508.19593","last_updated":"2025-08-27T06:06:18Z","snapshot_observed_at":"2026-08-16T12:37:30.146432Z","submitted_at":"2025-08-27T06:06:18Z","title":"Generalizing Monocular 3D Object Detection","version":1},"reference_index":51,"source":"pdf_text","source_observed_at":"2026-08-15T16:56:45.757486Z"},"links":{"citing_paper":"/paper/2508.19593"},"observation_digest":"sha256:39db52ae58cb9a13b90deaeee6ea8e7f6c6ccdf8209596e2e76042df66c116b5","observation_id":"7a923d11-5ace-4512-937c-95bbf9aa723e","resolution":{"observed_at":"2026-08-15T16:56:45.757486Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T16:56:45.761015Z","title":"Learning depth-guided convolutions for monocular3D object detection","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2508.19593","last_updated":"2025-08-27T06:06:18Z","snapshot_observed_at":"2026-08-16T12:37:30.146432Z","submitted_at":"2025-08-27T06:06:18Z","title":"Generalizing Monocular 3D Object Detection","version":1},"reference_index":52,"source":"pdf_text","source_observed_at":"2026-08-15T16:56:45.761015Z"},"links":{"citing_paper":"/paper/2508.19593"},"observation_digest":"sha256:d264ee7422f4a4d6b1fd87ea2043b3289702e0f77e4c32d05a35757002c27f21","observation_id":"22c7b739-4c01-4bce-8259-ef915e7c7bbc","resolution":{"observed_at":"2026-08-15T16:56:45.761015Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T16:56:45.765487Z","title":"SpatialDETR:Robustscalabletransformer-based 3Dobjectdetectionfrom multi-view camera images with global cross-sensor attention","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2508.19593","last_updated":"2025-08-27T06:06:18Z","snapshot_observed_at":"2026-08-16T12:37:30.146432Z","submitted_at":"2025-08-27T06:06:18Z","title":"Generalizing Monocular 3D Object Detection","version":1},"reference_index":53,"source":"pdf_text","source_observed_at":"2026-08-15T16:56:45.765487Z"},"links":{"citing_paper":"/paper/2508.19593"},"observation_digest":"sha256:e72e03f1ed78c619aaa558d834d5b866b456c3d23470877322f48b74207d7490","observation_id":"949cbf4c-4173-42df-b15b-d71411082eed","resolution":{"observed_at":"2026-08-15T16:56:45.765487Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T16:56:45.768788Z","title":"Benchmarking robustness of3D object detection to common corruptions","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2508.19593","last_updated":"2025-08-27T06:06:18Z","snapshot_observed_at":"2026-08-16T12:37:30.146432Z","submitted_at":"2025-08-27T06:06:18Z","title":"Generalizing Monocular 3D Object Detection","version":1},"reference_index":54,"source":"pdf_text","source_observed_at":"2026-08-15T16:56:45.768788Z"},"links":{"citing_paper":"/paper/2508.19593"},"observation_digest":"sha256:92f4cf4884ec9b1eddf0697b5316e1053d1e3f85c942fa02345958d805973261","observation_id":"63dfbb1c-d143-4d14-bac0-6622a3f4dea7","resolution":{"observed_at":"2026-08-15T16:56:45.768788Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T16:56:45.772171Z","title":"Animageisworth16x16words: Transformersforimage recognition at scale","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2508.19593","last_updated":"2025-08-27T06:06:18Z","snapshot_observed_at":"2026-08-16T12:37:30.146432Z","submitted_at":"2025-08-27T06:06:18Z","title":"Generalizing Monocular 3D Object Detection","version":1},"reference_index":55,"source":"pdf_text","source_observed_at":"2026-08-15T16:56:45.772171Z"},"links":{"citing_paper":"/paper/2508.19593"},"observation_digest":"sha256:6e2f4e90d86ccd5ad2bcf2608f75eb9a12bac1176636e820610857d6cb3d7972","observation_id":"491a953a-1df0-4c3a-9c10-53387b6dd76e","resolution":{"observed_at":"2026-08-15T16:56:45.772171Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T16:56:45.775909Z","title":"Polar transformer networks","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2508.19593","last_updated":"2025-08-27T06:06:18Z","snapshot_observed_at":"2026-08-16T12:37:30.146432Z","submitted_at":"2025-08-27T06:06:18Z","title":"Generalizing Monocular 3D Object Detection","version":1},"reference_index":56,"source":"pdf_text","source_observed_at":"2026-08-15T16:56:45.775909Z"},"links":{"citing_paper":"/paper/2508.19593"},"observation_digest":"sha256:604540680e73b8c7b1727adfffa5ba105afbcd920a7d1c275fd99c6cd9a35ce7","observation_id":"30d63e81-6122-4994-935a-c70c0aca1a21","resolution":{"observed_at":"2026-08-15T16:56:45.775909Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T16:56:45.779672Z","title":"CAM-Convs: Camera-aware multi-scale convolutions for single-view depth","venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2508.19593","last_updated":"2025-08-27T06:06:18Z","snapshot_observed_at":"2026-08-16T12:37:30.146432Z","submitted_at":"2025-08-27T06:06:18Z","title":"Generalizing Monocular 3D Object Detection","version":1},"reference_index":57,"source":"pdf_text","source_observed_at":"2026-08-15T16:56:45.779672Z"},"links":{"citing_paper":"/paper/2508.19593"},"observation_digest":"sha256:d0fa4b8412f2fd4385b2ce1606a14ebcc49113661f318b065f54252c0030ac4a","observation_id":"c10843fb-eb3e-4500-bd66-b988ec4ba005","resolution":{"observed_at":"2026-08-15T16:56:45.779672Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T16:56:45.785633Z","title":"Fully sparse3D object detection","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2508.19593","last_updated":"2025-08-27T06:06:18Z","snapshot_observed_at":"2026-08-16T12:37:30.146432Z","submitted_at":"2025-08-27T06:06:18Z","title":"Generalizing Monocular 3D Object Detection","version":1},"reference_index":58,"source":"pdf_text","source_observed_at":"2026-08-15T16:56:45.785633Z"},"links":{"citing_paper":"/paper/2508.19593"},"observation_digest":"sha256:ff00f96566c81c6d89fd37f3afc8f81e311b0e036f33e748dbed66ff5f70180b","observation_id":"9a878927-a0bd-45b7-958d-98d42ca3ac02","resolution":{"observed_at":"2026-08-15T16:56:45.785633Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2211.12501","last_updated":"2023-04-04T09:34:04Z","snapshot_observed_at":"2026-08-16T16:14:05.430730Z","submitted_at":"2022-11-22T18:59:52Z","title":"AeDet: Azimuth-invariant Multi-view 3D Object Detection","version":3},"cited_work":{"arxiv_id":"2211.12501","doi":null,"metadata_source":"pith","pith_arxiv_id":"2211.12501","snapshot_observed_at":"2026-08-15T16:56:47.148748Z","title":"AeDet: Azimuth-invariant Multi-view 3D Object Detection","venue":"cs.CV","work_id":"9ce54354-43bf-4c9e-b4a9-43dbdd96cf2d","year":2022},"citing_paper":{"arxiv_id":"2508.19593","last_updated":"2025-08-27T06:06:18Z","snapshot_observed_at":"2026-08-16T12:37:30.146432Z","submitted_at":"2025-08-27T06:06:18Z","title":"Generalizing Monocular 3D Object Detection","version":1},"reference_index":59,"source":"pdf_text","source_observed_at":"2026-08-15T16:56:45.789445Z"},"links":{"cited_paper":"/paper/2211.12501","citing_paper":"/paper/2508.19593"},"observation_digest":"sha256:b3d342d149329e70a2cd820da7502421f55bbd44d28d92ba7d05ea78886b8ca1","observation_id":"0da82e6f-6f61-4452-92aa-a077cb36949f","resolution":{"observed_at":"2026-08-15T16:56:47.153968Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T16:56:45.793348Z","title":"A tesla driver was killed after smashing into a firetruck on a california highway","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2508.19593","last_updated":"2025-08-27T06:06:18Z","snapshot_observed_at":"2026-08-16T12:37:30.146432Z","submitted_at":"2025-08-27T06:06:18Z","title":"Generalizing Monocular 3D Object Detection","version":1},"reference_index":60,"source":"pdf_text","source_observed_at":"2026-08-15T16:56:45.793348Z"},"links":{"citing_paper":"/paper/2508.19593"},"observation_digest":"sha256:45056640be6d370778b3264a3be41812830205402a02736fb3cb0e4cf93e7604","observation_id":"0997ac6c-e360-445d-ae31-629649817569","resolution":{"observed_at":"2026-08-15T16:56:45.793348Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T16:56:45.797209Z","title":"3D object detection and viewpoint estimation with a deformable3D cuboid model","venue":null,"work_id":null,"year":2012},"citing_paper":{"arxiv_id":"2508.19593","last_updated":"2025-08-27T06:06:18Z","snapshot_observed_at":"2026-08-16T12:37:30.146432Z","submitted_at":"2025-08-27T06:06:18Z","title":"Generalizing Monocular 3D Object Detection","version":1},"reference_index":61,"source":"pdf_text","source_observed_at":"2026-08-15T16:56:45.797209Z"},"links":{"citing_paper":"/paper/2508.19593"},"observation_digest":"sha256:1c660a4f6a5ff5f765af265942d57854742b6e72d08165b5f8d4fc83c6b522e1","observation_id":"118aaf3e-03a2-4440-8c9b-392577dbdaef","resolution":{"observed_at":"2026-08-15T16:56:45.797209Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T16:56:45.800676Z","title":"The design and use of steerable filters.TPAMI,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2508.19593","last_updated":"2025-08-27T06:06:18Z","snapshot_observed_at":"2026-08-16T12:37:30.146432Z","submitted_at":"2025-08-27T06:06:18Z","title":"Generalizing Monocular 3D Object Detection","version":1},"reference_index":62,"source":"pdf_text","source_observed_at":"2026-08-15T16:56:45.800676Z"},"links":{"citing_paper":"/paper/2508.19593"},"observation_digest":"sha256:36446498c8b96128de0d326efcf18e26008a444f5ccfde89d183ae5149cb9e2f","observation_id":"22824d8e-6c40-4296-8044-ee046d445aec","resolution":{"observed_at":"2026-08-15T16:56:45.800676Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2106.10044","last_updated":"2021-06-18T10:31:00Z","snapshot_observed_at":"2026-08-16T18:16:08.565718Z","submitted_at":"2021-06-18T10:31:00Z","title":"Training or Architecture? How to Incorporate Invariance in Neural Networks","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2106.10044","snapshot_observed_at":"2026-08-15T16:56:45.804865Z","title":"Training or architecture? how to incorporate invariance in neural networks.arXiv preprint arXiv:2106.10044, 2021","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2508.19593","last_updated":"2025-08-27T06:06:18Z","snapshot_observed_at":"2026-08-16T12:37:30.146432Z","submitted_at":"2025-08-27T06:06:18Z","title":"Generalizing Monocular 3D Object Detection","version":1},"reference_index":63,"source":"pdf_text","source_observed_at":"2026-08-15T16:56:45.804865Z"},"links":{"cited_paper":"/paper/2106.10044","citing_paper":"/paper/2508.19593"},"observation_digest":"sha256:849ea3e9e7b269241c57d9af917ac62c59e3801dc486e0b179d4efa91b4d389e","observation_id":"93cd73fd-5fb6-4914-b2fd-819fef221054","resolution":{"observed_at":"2026-08-15T16:56:45.804865Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T16:56:45.808441Z","title":"Hyperbolic neural net- works","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2508.19593","last_updated":"2025-08-27T06:06:18Z","snapshot_observed_at":"2026-08-16T12:37:30.146432Z","submitted_at":"2025-08-27T06:06:18Z","title":"Generalizing Monocular 3D Object Detection","version":1},"reference_index":64,"source":"pdf_text","source_observed_at":"2026-08-15T16:56:45.808441Z"},"links":{"citing_paper":"/paper/2508.19593"},"observation_digest":"sha256:6ac52e2b6797b7abba685b1837025d7ff2fe560d108ca7e4b8577a5543c508c6","observation_id":"b1b99301-d893-49ee-817c-ffc680d44934","resolution":{"observed_at":"2026-08-15T16:56:45.808441Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T16:56:45.811856Z","title":"3D-LaneNet: end-to-end 3D multiple lane detection","venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2508.19593","last_updated":"2025-08-27T06:06:18Z","snapshot_observed_at":"2026-08-16T12:37:30.146432Z","submitted_at":"2025-08-27T06:06:18Z","title":"Generalizing Monocular 3D Object Detection","version":1},"reference_index":65,"source":"pdf_text","source_observed_at":"2026-08-15T16:56:45.811856Z"},"links":{"citing_paper":"/paper/2508.19593"},"observation_digest":"sha256:dd4869e985441f3854715d6a177c58e626e9599c83252d64cd28f8cfacecdfb6","observation_id":"a19506ca-982d-45aa-b107-3b4783598c04","resolution":{"observed_at":"2026-08-15T16:56:45.811856Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T16:56:45.815389Z","title":"Vision meets robotics: The KITTI dataset.ĲRR, 2013","venue":null,"work_id":null,"year":2013},"citing_paper":{"arxiv_id":"2508.19593","last_updated":"2025-08-27T06:06:18Z","snapshot_observed_at":"2026-08-16T12:37:30.146432Z","submitted_at":"2025-08-27T06:06:18Z","title":"Generalizing Monocular 3D Object Detection","version":1},"reference_index":66,"source":"pdf_text","source_observed_at":"2026-08-15T16:56:45.815389Z"},"links":{"citing_paper":"/paper/2508.19593"},"observation_digest":"sha256:9c608fac6542b7d311093b9adacc5e8927d066d9ac10bd332c7d07bb99cc787a","observation_id":"dae74b9c-40cf-433e-be4b-ee2ae0668de6","resolution":{"observed_at":"2026-08-15T16:56:45.815389Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T16:56:45.818952Z","title":"Are we ready for autonomous driving? the KITTI vision benchmark suite","venue":null,"work_id":null,"year":2012},"citing_paper":{"arxiv_id":"2508.19593","last_updated":"2025-08-27T06:06:18Z","snapshot_observed_at":"2026-08-16T12:37:30.146432Z","submitted_at":"2025-08-27T06:06:18Z","title":"Generalizing Monocular 3D Object Detection","version":1},"reference_index":67,"source":"pdf_text","source_observed_at":"2026-08-15T16:56:45.818952Z"},"links":{"citing_paper":"/paper/2508.19593"},"observation_digest":"sha256:074400a62af036356c94b106f6b6b4bc03e44794ede0df8c61fe691910aa82cb","observation_id":"096ce334-55b3-459c-ab57-4b67895b77a3","resolution":{"observed_at":"2026-08-15T16:56:45.818952Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T16:56:45.822741Z","title":"Scalesteerablefiltersforlocallyscale-invariantconvolu- tional neural networks","venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2508.19593","last_updated":"2025-08-27T06:06:18Z","snapshot_observed_at":"2026-08-16T12:37:30.146432Z","submitted_at":"2025-08-27T06:06:18Z","title":"Generalizing Monocular 3D Object Detection","version":1},"reference_index":68,"source":"pdf_text","source_observed_at":"2026-08-15T16:56:45.822741Z"},"links":{"citing_paper":"/paper/2508.19593"},"observation_digest":"sha256:13e1627942cbe005dcefde3e470bbab188d36fe7314696838f8c6e679bf2027f","observation_id":"cf937a2e-dcb1-45cc-a386-8048076f74c0","resolution":{"observed_at":"2026-08-15T16:56:45.822741Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T16:56:45.826407Z","title":"Fast R-CNN","venue":null,"work_id":null,"year":2015},"citing_paper":{"arxiv_id":"2508.19593","last_updated":"2025-08-27T06:06:18Z","snapshot_observed_at":"2026-08-16T12:37:30.146432Z","submitted_at":"2025-08-27T06:06:18Z","title":"Generalizing Monocular 3D Object Detection","version":1},"reference_index":69,"source":"pdf_text","source_observed_at":"2026-08-15T16:56:45.826407Z"},"links":{"citing_paper":"/paper/2508.19593"},"observation_digest":"sha256:5af65be0315755af4530123a8341856f70147ed2a6d678c3f4fbcc156fe8ef03","observation_id":"5973bac5-04f2-46a2-8741-0262ebc6fe45","resolution":{"observed_at":"2026-08-15T16:56:45.826407Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T16:56:45.830024Z","title":"Rich feature hierarchies for accurate object detection and semantic segmentation","venue":null,"work_id":null,"year":2014},"citing_paper":{"arxiv_id":"2508.19593","last_updated":"2025-08-27T06:06:18Z","snapshot_observed_at":"2026-08-16T12:37:30.146432Z","submitted_at":"2025-08-27T06:06:18Z","title":"Generalizing Monocular 3D Object Detection","version":1},"reference_index":70,"source":"pdf_text","source_observed_at":"2026-08-15T16:56:45.830024Z"},"links":{"citing_paper":"/paper/2508.19593"},"observation_digest":"sha256:06c12b3585d4b142a17409166ada6b08aa730f811b2aec6b43d98d979be45b45","observation_id":"f17ee392-30b8-47d1-8485-dc49eefb9826","resolution":{"observed_at":"2026-08-15T16:56:45.830024Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T16:56:45.833265Z","title":"Matrix computations","venue":null,"work_id":null,"year":2013},"citing_paper":{"arxiv_id":"2508.19593","last_updated":"2025-08-27T06:06:18Z","snapshot_observed_at":"2026-08-16T12:37:30.146432Z","submitted_at":"2025-08-27T06:06:18Z","title":"Generalizing Monocular 3D Object Detection","version":1},"reference_index":71,"source":"pdf_text","source_observed_at":"2026-08-15T16:56:45.833265Z"},"links":{"citing_paper":"/paper/2508.19593"},"observation_digest":"sha256:ecfe3dc80d1e7b15c42a0e90d1ccbb3b2d3db20cf575cff0f968366da9262f75","observation_id":"732e54b0-7328-423b-96f1-0bf0c472f8e0","resolution":{"observed_at":"2026-08-15T16:56:45.833265Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T16:56:45.836799Z","title":"Bird’s-eye-viewpanopticsegmentationusingmonocular frontal view images.RAL, 2022","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2508.19593","last_updated":"2025-08-27T06:06:18Z","snapshot_observed_at":"2026-08-16T12:37:30.146432Z","submitted_at":"2025-08-27T06:06:18Z","title":"Generalizing Monocular 3D Object Detection","version":1},"reference_index":72,"source":"pdf_text","source_observed_at":"2026-08-15T16:56:45.836799Z"},"links":{"citing_paper":"/paper/2508.19593"},"observation_digest":"sha256:358d720f01b3809700d3efc39ccad4ef3cbfb5f6fa03c855d7552b345efc8fce","observation_id":"c058e2a0-ee5c-41cd-9233-036fa8dacdae","resolution":{"observed_at":"2026-08-15T16:56:45.836799Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T16:56:45.839978Z","title":"Gen-lanenet: A generalized and scalable approach for3D lane detection","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2508.19593","last_updated":"2025-08-27T06:06:18Z","snapshot_observed_at":"2026-08-16T12:37:30.146432Z","submitted_at":"2025-08-27T06:06:18Z","title":"Generalizing Monocular 3D Object Detection","version":1},"reference_index":73,"source":"pdf_text","source_observed_at":"2026-08-15T16:56:45.839978Z"},"links":{"citing_paper":"/paper/2508.19593"},"observation_digest":"sha256:762c08e278eb8fc5f60b296362b4b95a9fbbbeec362b7c66f9fcdb5b437a4cc1","observation_id":"2aba1ecd-6d3d-4c4f-b849-b00337f8e265","resolution":{"observed_at":"2026-08-15T16:56:45.839978Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T16:56:45.843164Z","title":"Simple- BEV: What really matters for multi-sensor BEV perception? InCoRL, 2022","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2508.19593","last_updated":"2025-08-27T06:06:18Z","snapshot_observed_at":"2026-08-16T12:37:30.146432Z","submitted_at":"2025-08-27T06:06:18Z","title":"Generalizing Monocular 3D Object Detection","version":1},"reference_index":74,"source":"pdf_text","source_observed_at":"2026-08-15T16:56:45.843164Z"},"links":{"citing_paper":"/paper/2508.19593"},"observation_digest":"sha256:ff3fb2539d633ab35653cdc60cfa701149a1fb7b0c824bda541a06cc26451fd7","observation_id":"338394f6-c899-4c0f-afbd-4ebac863447b","resolution":{"observed_at":"2026-08-15T16:56:45.843164Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T16:56:45.846648Z","title":"A combined corner and edge detector","venue":null,"work_id":null,"year":1988},"citing_paper":{"arxiv_id":"2508.19593","last_updated":"2025-08-27T06:06:18Z","snapshot_observed_at":"2026-08-16T12:37:30.146432Z","submitted_at":"2025-08-27T06:06:18Z","title":"Generalizing Monocular 3D Object Detection","version":1},"reference_index":75,"source":"pdf_text","source_observed_at":"2026-08-15T16:56:45.846648Z"},"links":{"citing_paper":"/paper/2508.19593"},"observation_digest":"sha256:b84353a2b3a646cce93aeed1b9000a893f6f36625fec3da40797febfe5761b83","observation_id":"432d29b3-97c5-4a42-a9f2-684104512074","resolution":{"observed_at":"2026-08-15T16:56:45.846648Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T16:56:45.849918Z","title":"Cam- bridge university press, 2003","venue":null,"work_id":null,"year":2003},"citing_paper":{"arxiv_id":"2508.19593","last_updated":"2025-08-27T06:06:18Z","snapshot_observed_at":"2026-08-16T12:37:30.146432Z","submitted_at":"2025-08-27T06:06:18Z","title":"Generalizing Monocular 3D Object Detection","version":1},"reference_index":76,"source":"pdf_text","source_observed_at":"2026-08-15T16:56:45.849918Z"},"links":{"citing_paper":"/paper/2508.19593"},"observation_digest":"sha256:c89be5feb10b7bb00686f09538acf5421b76432c1e2531cfb10a294d82f0e0eb","observation_id":"fb116794-e8ca-4bf1-92a8-5e5a7121e48a","resolution":{"observed_at":"2026-08-15T16:56:45.849918Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T16:56:45.853809Z","title":"Deepresiduallearningforimage recognition","venue":null,"work_id":null,"year":2016},"citing_paper":{"arxiv_id":"2508.19593","last_updated":"2025-08-27T06:06:18Z","snapshot_observed_at":"2026-08-16T12:37:30.146432Z","submitted_at":"2025-08-27T06:06:18Z","title":"Generalizing Monocular 3D Object Detection","version":1},"reference_index":77,"source":"pdf_text","source_observed_at":"2026-08-15T16:56:45.853809Z"},"links":{"citing_paper":"/paper/2508.19593"},"observation_digest":"sha256:e898cf2787362fa4453be947939e8a39db748c46172006bc4916d24fbc65d4e3","observation_id":"45142b55-45e9-401e-811e-fa34ada183de","resolution":{"observed_at":"2026-08-15T16:56:45.853809Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T16:56:45.857266Z","title":"End-to-end training of object class detectors for mean average precision","venue":null,"work_id":null,"year":2016},"citing_paper":{"arxiv_id":"2508.19593","last_updated":"2025-08-27T06:06:18Z","snapshot_observed_at":"2026-08-16T12:37:30.146432Z","submitted_at":"2025-08-27T06:06:18Z","title":"Generalizing Monocular 3D Object Detection","version":1},"reference_index":78,"source":"pdf_text","source_observed_at":"2026-08-15T16:56:45.857266Z"},"links":{"citing_paper":"/paper/2508.19593"},"observation_digest":"sha256:2a6fb8ad774f12d8b6e9c2b1220d1a2172aec75c876b6339c818ec79b3ef9376","observation_id":"10e67bea-9fcb-4f51-8101-2b6ff984f317","resolution":{"observed_at":"2026-08-15T16:56:45.857266Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T16:56:45.861374Z","title":"Warped convolutions: Efficient invariance to spatial transformations","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2508.19593","last_updated":"2025-08-27T06:06:18Z","snapshot_observed_at":"2026-08-16T12:37:30.146432Z","submitted_at":"2025-08-27T06:06:18Z","title":"Generalizing Monocular 3D Object Detection","version":1},"reference_index":79,"source":"pdf_text","source_observed_at":"2026-08-15T16:56:45.861374Z"},"links":{"citing_paper":"/paper/2508.19593"},"observation_digest":"sha256:10818ecae098ffedd2ecea27833b256d8af57abbbf4b774a4bfcd1c01a901497","observation_id":"b876e363-2853-4ca6-8716-3c57715aaa9b","resolution":{"observed_at":"2026-08-15T16:56:45.861374Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T16:56:45.865423Z","title":"A convnet for non-maximum suppres- sion","venue":null,"work_id":null,"year":2016},"citing_paper":{"arxiv_id":"2508.19593","last_updated":"2025-08-27T06:06:18Z","snapshot_observed_at":"2026-08-16T12:37:30.146432Z","submitted_at":"2025-08-27T06:06:18Z","title":"Generalizing Monocular 3D Object Detection","version":1},"reference_index":80,"source":"pdf_text","source_observed_at":"2026-08-15T16:56:45.865423Z"},"links":{"citing_paper":"/paper/2508.19593"},"observation_digest":"sha256:633d7b4684979495f78bbf884ec129ad69ca3ec9be6184f0998e9f6b48d63ef6","observation_id":"65287b1e-fab1-42fe-80e0-b3cf2da7fd2b","resolution":{"observed_at":"2026-08-15T16:56:45.865423Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T16:56:45.869457Z","title":"Learning non-maximum suppression","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2508.19593","last_updated":"2025-08-27T06:06:18Z","snapshot_observed_at":"2026-08-16T12:37:30.146432Z","submitted_at":"2025-08-27T06:06:18Z","title":"Generalizing Monocular 3D Object Detection","version":1},"reference_index":81,"source":"pdf_text","source_observed_at":"2026-08-15T16:56:45.869457Z"},"links":{"citing_paper":"/paper/2508.19593"},"observation_digest":"sha256:38a061abc6edd8216f1a9e9265f7290d38c5419e0a9c4962212f100be558cd3e","observation_id":"4ff339ca-c637-48dc-ae01-cb264a91f335","resolution":{"observed_at":"2026-08-15T16:56:45.869457Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T16:56:45.873022Z","title":"OPEN:Object-wisepositionembeddingformulti-view 3Dobjectdetection","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2508.19593","last_updated":"2025-08-27T06:06:18Z","snapshot_observed_at":"2026-08-16T12:37:30.146432Z","submitted_at":"2025-08-27T06:06:18Z","title":"Generalizing Monocular 3D Object Detection","version":1},"reference_index":82,"source":"pdf_text","source_observed_at":"2026-08-15T16:56:45.873022Z"},"links":{"citing_paper":"/paper/2508.19593"},"observation_digest":"sha256:482b4b3cf506959cbf7353cd653292d92a232f22270628b82ba538241f207c52","observation_id":"cf9697ae-b467-4656-a0d3-c8677ded8bed","resolution":{"observed_at":"2026-08-15T16:56:45.873022Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T16:56:45.877622Z","title":"FIERY: future instance prediction in bird’s-eye view from surround monocular cameras","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2508.19593","last_updated":"2025-08-27T06:06:18Z","snapshot_observed_at":"2026-08-16T12:37:30.146432Z","submitted_at":"2025-08-27T06:06:18Z","title":"Generalizing Monocular 3D Object Detection","version":1},"reference_index":83,"source":"pdf_text","source_observed_at":"2026-08-15T16:56:45.877622Z"},"links":{"citing_paper":"/paper/2508.19593"},"observation_digest":"sha256:f73676bc269d2fe9f307ac7ff19748de9d4481eb78b9ec8ced2b73124ca68127","observation_id":"bf1f9cdd-1737-4bb0-8ada-b2f09dc26ec3","resolution":{"observed_at":"2026-08-15T16:56:45.877622Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T16:56:45.882838Z","title":"Investigating theimpactofmulti-LiDARplacementonobjectdetectionforautonomousdriving","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2508.19593","last_updated":"2025-08-27T06:06:18Z","snapshot_observed_at":"2026-08-16T12:37:30.146432Z","submitted_at":"2025-08-27T06:06:18Z","title":"Generalizing Monocular 3D Object Detection","version":1},"reference_index":84,"source":"pdf_text","source_observed_at":"2026-08-15T16:56:45.882838Z"},"links":{"citing_paper":"/paper/2508.19593"},"observation_digest":"sha256:d51340d42fc5172b0f7f7c41a24b079ca8f83e289b98d6371faf8c1f592438ab","observation_id":"4f4d569c-1606-402e-a632-9cd98c1fca03","resolution":{"observed_at":"2026-08-15T16:56:45.882838Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T16:56:45.887410Z","title":"What you see is what you get: Exploiting visibility for3D object detection","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2508.19593","last_updated":"2025-08-27T06:06:18Z","snapshot_observed_at":"2026-08-16T12:37:30.146432Z","submitted_at":"2025-08-27T06:06:18Z","title":"Generalizing Monocular 3D Object Detection","version":1},"reference_index":85,"source":"pdf_text","source_observed_at":"2026-08-15T16:56:45.887410Z"},"links":{"citing_paper":"/paper/2508.19593"},"observation_digest":"sha256:962ced8e68e2dbb538836cdcd881e173373cfdd08746cd7a87290ef6b69c7d07","observation_id":"c987b4ff-a4ce-4248-a129-04b6b09d5017","resolution":{"observed_at":"2026-08-15T16:56:45.887410Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T16:56:45.891011Z","title":"Densely connected convolutional networks","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2508.19593","last_updated":"2025-08-27T06:06:18Z","snapshot_observed_at":"2026-08-16T12:37:30.146432Z","submitted_at":"2025-08-27T06:06:18Z","title":"Generalizing Monocular 3D Object Detection","version":1},"reference_index":86,"source":"pdf_text","source_observed_at":"2026-08-15T16:56:45.891011Z"},"links":{"citing_paper":"/paper/2508.19593"},"observation_digest":"sha256:0158298e8e4a8d90fe19600973c7d0fc5f4c9a4e5e0f8aeaa42e59b4c55f10a9","observation_id":"46507a7f-b06c-4838-8385-a81cca6561a1","resolution":{"observed_at":"2026-08-15T16:56:45.891011Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2203.17054","last_updated":"2022-06-16T09:44:08Z","snapshot_observed_at":"2026-08-16T17:10:15.129652Z","submitted_at":"2022-03-31T14:21:19Z","title":"BEVDet4D: Exploit Temporal Cues in Multi-camera 3D Object Detection","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2203.17054","snapshot_observed_at":"2026-08-15T16:56:45.894740Z","title":"BEVDet4D: Exploit temporal cues in multi-camera3D object detection.arXiv preprint arXiv:2203.17054, 2022","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2508.19593","last_updated":"2025-08-27T06:06:18Z","snapshot_observed_at":"2026-08-16T12:37:30.146432Z","submitted_at":"2025-08-27T06:06:18Z","title":"Generalizing Monocular 3D Object Detection","version":1},"reference_index":87,"source":"pdf_text","source_observed_at":"2026-08-15T16:56:45.894740Z"},"links":{"cited_paper":"/paper/2203.17054","citing_paper":"/paper/2508.19593"},"observation_digest":"sha256:037544415712e3bba4c345c27e3152df6203524f58a090d68801622b5f54168a","observation_id":"76615bec-adc8-403f-974a-e6447d6958c1","resolution":{"observed_at":"2026-08-15T16:56:45.894740Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2112.11790","last_updated":"2022-06-16T09:15:52Z","snapshot_observed_at":"2026-07-06T12:21:28.059661Z","submitted_at":"2021-12-22T10:48:06Z","title":"BEVDet: High-performance Multi-camera 3D Object Detection in Bird-Eye-View","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2112.11790","snapshot_observed_at":"2026-08-15T16:56:45.898373Z","title":"BEVDet: High-performance multi-camera 3D object detection in bird-eye-view","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2508.19593","last_updated":"2025-08-27T06:06:18Z","snapshot_observed_at":"2026-08-16T12:37:30.146432Z","submitted_at":"2025-08-27T06:06:18Z","title":"Generalizing Monocular 3D Object Detection","version":1},"reference_index":88,"source":"pdf_text","source_observed_at":"2026-08-15T16:56:45.898373Z"},"links":{"cited_paper":"/paper/2112.11790","citing_paper":"/paper/2508.19593"},"observation_digest":"sha256:4d20fab101f07bf03c721ce1a4841c6bbafba7017bd295c605ef735e8ab225f5","observation_id":"e442f13b-143d-4692-8547-261bf2ffe443","resolution":{"observed_at":"2026-08-15T16:56:45.898373Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T16:56:45.901950Z","title":"InCVPR, 2022","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2508.19593","last_updated":"2025-08-27T06:06:18Z","snapshot_observed_at":"2026-08-16T12:37:30.146432Z","submitted_at":"2025-08-27T06:06:18Z","title":"Generalizing Monocular 3D Object Detection","version":1},"reference_index":89,"source":"pdf_text","source_observed_at":"2026-08-15T16:56:45.901950Z"},"links":{"citing_paper":"/paper/2508.19593"},"observation_digest":"sha256:e2609931a123898f8ab8f634e6fab54c9cb8db67374cede17bf07168ae4fd217","observation_id":"5af0e755-7f2c-49d3-90a8-c966086c08fb","resolution":{"observed_at":"2026-08-15T16:56:45.901950Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T16:56:45.905279Z","title":"EPNet: Enhancing point features with image semantics for3D object detection","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2508.19593","last_updated":"2025-08-27T06:06:18Z","snapshot_observed_at":"2026-08-16T12:37:30.146432Z","submitted_at":"2025-08-27T06:06:18Z","title":"Generalizing Monocular 3D Object Detection","version":1},"reference_index":90,"source":"pdf_text","source_observed_at":"2026-08-15T16:56:45.905279Z"},"links":{"citing_paper":"/paper/2508.19593"},"observation_digest":"sha256:49263bb78369789e5a7703847b3c97c445b08ef18dd967fc6aa13954de62abe6","observation_id":"931123df-4a08-4c16-b118-9eab790ac36c","resolution":{"observed_at":"2026-08-15T16:56:45.905279Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T16:56:45.908937Z","title":"STXD:Structural andtemporalcross-modaldistillationformulti-view 3Dobjectdetection","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2508.19593","last_updated":"2025-08-27T06:06:18Z","snapshot_observed_at":"2026-08-16T12:37:30.146432Z","submitted_at":"2025-08-27T06:06:18Z","title":"Generalizing Monocular 3D Object Detection","version":1},"reference_index":91,"source":"pdf_text","source_observed_at":"2026-08-15T16:56:45.908937Z"},"links":{"citing_paper":"/paper/2508.19593"},"observation_digest":"sha256:934d8cd2e39a87a98c1fc112395771bbe1bc147c153a67c51ea1bb10ed348965","observation_id":"1ff38759-d08c-40d6-a87c-0897fe51ad35","resolution":{"observed_at":"2026-08-15T16:56:45.908937Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T16:56:45.912408Z","title":"Scale-invariant scale-channel networks: Deep networks that generalise to previously unseen scales.ĲCV, 2021","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2508.19593","last_updated":"2025-08-27T06:06:18Z","snapshot_observed_at":"2026-08-16T12:37:30.146432Z","submitted_at":"2025-08-27T06:06:18Z","title":"Generalizing Monocular 3D Object Detection","version":1},"reference_index":92,"source":"pdf_text","source_observed_at":"2026-08-15T16:56:45.912408Z"},"links":{"citing_paper":"/paper/2508.19593"},"observation_digest":"sha256:c759911f7d5e20f5ca5c1bb261f3ecbc2a681f7b32a3422ac8a52ca1182678dc","observation_id":"e5c0501d-7922-42b5-b0eb-013d1b66fedd","resolution":{"observed_at":"2026-08-15T16:56:45.912408Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T16:56:45.916288Z","title":"Enhancing 3Dobjectdetectionwith 2D detection-guided query anchors","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2508.19593","last_updated":"2025-08-27T06:06:18Z","snapshot_observed_at":"2026-08-16T12:37:30.146432Z","submitted_at":"2025-08-27T06:06:18Z","title":"Generalizing Monocular 3D Object Detection","version":1},"reference_index":93,"source":"pdf_text","source_observed_at":"2026-08-15T16:56:45.916288Z"},"links":{"citing_paper":"/paper/2508.19593"},"observation_digest":"sha256:b133fb284da00ad91f68b0b282256b302a264adf4a78ab00beafc403749abdbb","observation_id":"12276854-acee-4b6f-9ef6-cb33a48e0074","resolution":{"observed_at":"2026-08-15T16:56:45.916288Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T16:56:45.919605Z","title":"MonoUNI:Aunifiedvehicleandinfrastructure-side monocular 3D object detection network with sufficient depth clues","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2508.19593","last_updated":"2025-08-27T06:06:18Z","snapshot_observed_at":"2026-08-16T12:37:30.146432Z","submitted_at":"2025-08-27T06:06:18Z","title":"Generalizing Monocular 3D Object Detection","version":1},"reference_index":94,"source":"pdf_text","source_observed_at":"2026-08-15T16:56:45.919605Z"},"links":{"citing_paper":"/paper/2508.19593"},"observation_digest":"sha256:81b937eb9513cf74cdf4560d326f64d791ce619f166da7c0d158279698611f34","observation_id":"41d9af42-244c-473b-9cd8-1de4547bef9e","resolution":{"observed_at":"2026-08-15T16:56:45.919605Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T16:56:45.923850Z","title":"Polarformer: Multi-camera 3D object detection with polar transformers","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2508.19593","last_updated":"2025-08-27T06:06:18Z","snapshot_observed_at":"2026-08-16T12:37:30.146432Z","submitted_at":"2025-08-27T06:06:18Z","title":"Generalizing Monocular 3D Object Detection","version":1},"reference_index":95,"source":"pdf_text","source_observed_at":"2026-08-15T16:56:45.923850Z"},"links":{"citing_paper":"/paper/2508.19593"},"observation_digest":"sha256:1fdc1f1b91e92d5375e23d9deb9c6cca7ec88157715b402577a0faf7c59510b9","observation_id":"daceddb3-9159-437f-8906-480dd33b230e","resolution":{"observed_at":"2026-08-15T16:56:45.923850Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T16:56:45.926976Z","title":"FSD-BEV:Foregroundself-distillationformulti-view 3Dobjectdetection","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2508.19593","last_updated":"2025-08-27T06:06:18Z","snapshot_observed_at":"2026-08-16T12:37:30.146432Z","submitted_at":"2025-08-27T06:06:18Z","title":"Generalizing Monocular 3D Object Detection","version":1},"reference_index":96,"source":"pdf_text","source_observed_at":"2026-08-15T16:56:45.926976Z"},"links":{"citing_paper":"/paper/2508.19593"},"observation_digest":"sha256:51f12010c0df658aa6cb27b1e96d087001305124b7bad6d2725e2cece49b5419","observation_id":"ab75cb65-7434-4c3a-b6ec-81e96ba92097","resolution":{"observed_at":"2026-08-15T16:56:45.926976Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T16:56:45.930245Z","title":"Physical symmetry enhanced neural networks","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2508.19593","last_updated":"2025-08-27T06:06:18Z","snapshot_observed_at":"2026-08-16T12:37:30.146432Z","submitted_at":"2025-08-27T06:06:18Z","title":"Generalizing Monocular 3D Object Detection","version":1},"reference_index":97,"source":"pdf_text","source_observed_at":"2026-08-15T16:56:45.930245Z"},"links":{"citing_paper":"/paper/2508.19593"},"observation_digest":"sha256:a56a967edfb156300b35f686ca0bbeb98875a5c11ab53e74c618b17663eb74f7","observation_id":"3cee754c-933e-42fe-825f-8eead9bedca4","resolution":{"observed_at":"2026-08-15T16:56:45.930245Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T16:56:45.933752Z","title":"Locally scale-invariant convolu- tional neural networks","venue":null,"work_id":null,"year":2014},"citing_paper":{"arxiv_id":"2508.19593","last_updated":"2025-08-27T06:06:18Z","snapshot_observed_at":"2026-08-16T12:37:30.146432Z","submitted_at":"2025-08-27T06:06:18Z","title":"Generalizing Monocular 3D Object Detection","version":1},"reference_index":98,"source":"pdf_text","source_observed_at":"2026-08-15T16:56:45.933752Z"},"links":{"citing_paper":"/paper/2508.19593"},"observation_digest":"sha256:4c37ffa937b13be38f149ddc6dc055b4325504d284840de9c1bb18bfb3738d2e","observation_id":"f1521cef-1759-4d50-a840-782ccf7154c6","resolution":{"observed_at":"2026-08-15T16:56:45.933752Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T16:56:45.937310Z","title":"Probabilistic anchor assignment with IoU prediction for object 86 detection","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2508.19593","last_updated":"2025-08-27T06:06:18Z","snapshot_observed_at":"2026-08-16T12:37:30.146432Z","submitted_at":"2025-08-27T06:06:18Z","title":"Generalizing Monocular 3D Object Detection","version":1},"reference_index":99,"source":"pdf_text","source_observed_at":"2026-08-15T16:56:45.937310Z"},"links":{"citing_paper":"/paper/2508.19593"},"observation_digest":"sha256:cdd86f02bf6c58086b58ca43cb1fc5f743ec7b20064c1ba84ac2cd58206be137","observation_id":"6ca68146-f531-4ca9-b3ad-7ee5c1ba99e9","resolution":{"observed_at":"2026-08-15T16:56:45.937310Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T16:56:45.940439Z","title":"La- belDistill: Label-guided cross-modal knowledge distillation for camera-based3D object detection","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2508.19593","last_updated":"2025-08-27T06:06:18Z","snapshot_observed_at":"2026-08-16T12:37:30.146432Z","submitted_at":"2025-08-27T06:06:18Z","title":"Generalizing Monocular 3D Object Detection","version":1},"reference_index":100,"source":"pdf_text","source_observed_at":"2026-08-15T16:56:45.940439Z"},"links":{"citing_paper":"/paper/2508.19593"},"observation_digest":"sha256:397823cf21b55344222f031d94ae2878d236ff5b488daddfa81e7b713e041823","observation_id":"4b316b94-3d08-4d88-8256-6d9ce06fad10","resolution":{"observed_at":"2026-08-15T16:56:45.940439Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"paper":{"arxiv_id":"2508.19593","last_updated":"2025-08-27T06:06:18Z","latest_version":1,"primary_category":"cs.CV","snapshot_observed_at":"2026-08-16T12:37:30.146432Z","submitted_at":"2025-08-27T06:06:18Z","title":"Generalizing Monocular 3D Object Detection"},"reference_resolution":{"displayed":100,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":98,"verified_exact":2,"verified_fuzzy":0},"total_outbound_references":300},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"thesis":"As of 16 August 2026, this Paper Citation Record lists 100 of 300 outbound references and 0 inbound Pith citation observations for arXiv:2508.19593."}