{"as_of":"2026-08-21T06:58:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:31160ddb848837c8e05620a8a6ceb2564a89ac4bba4e3cb5901cb6be9390b213","coverage":[{"denominator":44,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":44,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-15T18:19:43.779994Z","state":"measured"},{"denominator":44,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":44,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-21T06:32:19.484+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2507.18331/citation-record","integrity":"/paper/2507.18331/integrity","json":"/paper/2507.18331/citation-record.json","paper":"/paper/2507.18331"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T18:19:44.271491Z","title":"Objectron: A large scale dataset of object-centric videos in the wild with pose annotations","venue":null,"work_id":"1bf3c216-87ad-4329-b6cd-bf46c97dfad9","year":2021},"citing_paper":{"arxiv_id":"2507.18331","last_updated":"2025-07-24T11:58:01Z","snapshot_observed_at":"2026-08-18T18:52:22.629116Z","submitted_at":"2025-07-24T11:58:01Z","title":"Boosting Multi-View Indoor 3D Object Detection via Adaptive 3D Volume Construction","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-15T18:19:43.622308Z"},"links":{"citing_paper":"/paper/2507.18331"},"observation_digest":"sha256:4605006efc510c6862c21b122bc38c8817bc84f832d2c27505ced4cc87b37e2b","observation_id":"06f9ca8e-89da-4606-9b1c-91b13df80361","resolution":{"observed_at":"2026-08-15T18:19:44.276044Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2111.08897","last_updated":"2022-01-12T08:19:29Z","snapshot_observed_at":"2026-07-06T12:09:19.763667Z","submitted_at":"2021-11-17T04:27:01Z","title":"ARKitScenes: A Diverse Real-World Dataset For 3D Indoor Scene Understanding Using Mobile RGB-D Data","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2111.08897","snapshot_observed_at":"2026-08-15T18:19:43.627531Z","title":"ARKitScenes: A diverse real-world dataset for 3d indoor scene understanding using mobile rgb-d data","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2507.18331","last_updated":"2025-07-24T11:58:01Z","snapshot_observed_at":"2026-08-18T18:52:22.629116Z","submitted_at":"2025-07-24T11:58:01Z","title":"Boosting Multi-View Indoor 3D Object Detection via Adaptive 3D Volume Construction","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-15T18:19:43.627531Z"},"links":{"cited_paper":"/paper/2111.08897","citing_paper":"/paper/2507.18331"},"observation_digest":"sha256:8e5ead55dac93695eaa76913fea3865f670e60ac274b63b3e1b85bc8eeae8c93","observation_id":"35cc0d22-a0c8-4c7f-b035-82a913237079","resolution":{"observed_at":"2026-08-15T18:19:43.627531Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T18:19:44.259247Z","title":"End-to- end object detection with transformers","venue":null,"work_id":"d0be2e08-3796-4c65-b81a-f4b8dbb8698a","year":2020},"citing_paper":{"arxiv_id":"2507.18331","last_updated":"2025-07-24T11:58:01Z","snapshot_observed_at":"2026-08-18T18:52:22.629116Z","submitted_at":"2025-07-24T11:58:01Z","title":"Boosting Multi-View Indoor 3D Object Detection via Adaptive 3D Volume Construction","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-15T18:19:43.631741Z"},"links":{"citing_paper":"/paper/2507.18331"},"observation_digest":"sha256:418c018b130059d78cb5a9ec4ff4474bc1e371e216b35de7f81c21f59f81f229","observation_id":"2aff32a9-5339-4d58-99ca-939785001a5c","resolution":{"observed_at":"2026-08-15T18:19:44.263960Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T18:19:44.247565Z","title":"MVSplat: Efficient 3d gaussian splatting from sparse multi-view images","venue":null,"work_id":"85f2540b-563a-4234-ba1b-7007a28e8369","year":2024},"citing_paper":{"arxiv_id":"2507.18331","last_updated":"2025-07-24T11:58:01Z","snapshot_observed_at":"2026-08-18T18:52:22.629116Z","submitted_at":"2025-07-24T11:58:01Z","title":"Boosting Multi-View Indoor 3D Object Detection via Adaptive 3D Volume Construction","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-15T18:19:43.635523Z"},"links":{"citing_paper":"/paper/2507.18331"},"observation_digest":"sha256:606339472583735f58790e72f6fcacb31c0564c40345bb187c9286e76e7a582b","observation_id":"e9e762e2-8ac2-4b59-abf1-72de3323b8e1","resolution":{"observed_at":"2026-08-15T18:19:44.251914Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T18:19:44.236322Z","title":"A space-sweep approach to true multi- image matching","venue":null,"work_id":"a7c4b0bb-b39c-4dad-8f25-ad091e3d2986","year":null},"citing_paper":{"arxiv_id":"2507.18331","last_updated":"2025-07-24T11:58:01Z","snapshot_observed_at":"2026-08-18T18:52:22.629116Z","submitted_at":"2025-07-24T11:58:01Z","title":"Boosting Multi-View Indoor 3D Object Detection via Adaptive 3D Volume Construction","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-15T18:19:43.639437Z"},"links":{"citing_paper":"/paper/2507.18331"},"observation_digest":"sha256:156319a7421b66d44537e3ec60aa0517d045d362495af55e4bd76f767fbab0bc","observation_id":"e35a0e99-3511-4706-9634-93525dbbcb6a","resolution":{"observed_at":"2026-08-15T18:19:44.240420Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T18:19:44.225833Z","title":"ScanNet: Richly-annotated 3d reconstructions of indoor scenes","venue":null,"work_id":"9a8121f8-5f87-42be-b0b2-72b45d11cbfc","year":2017},"citing_paper":{"arxiv_id":"2507.18331","last_updated":"2025-07-24T11:58:01Z","snapshot_observed_at":"2026-08-18T18:52:22.629116Z","submitted_at":"2025-07-24T11:58:01Z","title":"Boosting Multi-View Indoor 3D Object Detection via Adaptive 3D Volume Construction","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-15T18:19:43.642914Z"},"links":{"citing_paper":"/paper/2507.18331"},"observation_digest":"sha256:a0ab746bc44d6c5699c7d1bf1cce4968c7994c73e6105bce04bf1b7dc885df42","observation_id":"e23deab3-db4a-4495-9fa1-9a7715b72e06","resolution":{"observed_at":"2026-08-15T18:19:44.229361Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T18:19:43.646393Z","title":"An image is worth 16x16 words: Transformers for image recognition at scale","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2507.18331","last_updated":"2025-07-24T11:58:01Z","snapshot_observed_at":"2026-08-18T18:52:22.629116Z","submitted_at":"2025-07-24T11:58:01Z","title":"Boosting Multi-View Indoor 3D Object Detection via Adaptive 3D Volume Construction","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-15T18:19:43.646393Z"},"links":{"citing_paper":"/paper/2507.18331"},"observation_digest":"sha256:2dca838b631d1ec57f456edcafbe14f57d3a0477dc1ff5219bbf4ae820155c31","observation_id":"f7e56130-a8f6-4118-bb63-767e3ee5d7e3","resolution":{"observed_at":"2026-08-15T18:19:43.646393Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T18:19:43.650187Z","title":"Deep residual learning for image recognition","venue":null,"work_id":null,"year":2016},"citing_paper":{"arxiv_id":"2507.18331","last_updated":"2025-07-24T11:58:01Z","snapshot_observed_at":"2026-08-18T18:52:22.629116Z","submitted_at":"2025-07-24T11:58:01Z","title":"Boosting Multi-View Indoor 3D Object Detection via Adaptive 3D Volume Construction","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-15T18:19:43.650187Z"},"links":{"citing_paper":"/paper/2507.18331"},"observation_digest":"sha256:4c7a8b98cb09e000a5a2dc85d15f5c1c68074f3c0f7f617f1b40118d1952a7b8","observation_id":"28314dbb-710f-4138-953e-65d53d0ba1ae","resolution":{"observed_at":"2026-08-15T18:19:43.650187Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T18:19:44.202561Z","title":"NeRF-Det++: Incorporat- ing semantic cues and perspective-aware depth supervision for indoor multi-view 3d detection","venue":null,"work_id":"fbd14782-6b11-4185-8da9-4e979c7d89cd","year":2025},"citing_paper":{"arxiv_id":"2507.18331","last_updated":"2025-07-24T11:58:01Z","snapshot_observed_at":"2026-08-18T18:52:22.629116Z","submitted_at":"2025-07-24T11:58:01Z","title":"Boosting Multi-View Indoor 3D Object Detection via Adaptive 3D Volume Construction","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-15T18:19:43.653535Z"},"links":{"citing_paper":"/paper/2507.18331"},"observation_digest":"sha256:4a9b7919e830f778c0e1d977f825a3435c6a09dfc84d25e5f6381a683c7446c9","observation_id":"80d14f6c-b082-4dfc-b082-710e91c53502","resolution":{"observed_at":"2026-08-15T18:19:44.206120Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2112.11790","last_updated":"2022-06-16T09:15:52Z","snapshot_observed_at":"2026-08-17T05:15:58.663240Z","submitted_at":"2021-12-22T10:48:06Z","title":"BEVDet: High-performance Multi-camera 3D Object Detection in Bird-Eye-View","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2112.11790","snapshot_observed_at":"2026-08-15T18:19:43.657076Z","title":"BEVDet: High-performance multi-camera 3d object de- tection in bird-eye-view","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2507.18331","last_updated":"2025-07-24T11:58:01Z","snapshot_observed_at":"2026-08-18T18:52:22.629116Z","submitted_at":"2025-07-24T11:58:01Z","title":"Boosting Multi-View Indoor 3D Object Detection via Adaptive 3D Volume Construction","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-15T18:19:43.657076Z"},"links":{"cited_paper":"/paper/2112.11790","citing_paper":"/paper/2507.18331"},"observation_digest":"sha256:92e102abe675d7daac93f35110c8417a246a06eb6c552ea811b0cab2e1a223e1","observation_id":"d6087566-1791-4af1-8c24-4885ba77b7a1","resolution":{"observed_at":"2026-08-15T18:19:43.657076Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2409.04234","last_updated":"2024-09-06T12:40:19Z","snapshot_observed_at":"2026-08-19T19:01:29.937610Z","submitted_at":"2024-09-06T12:40:19Z","title":"UniDet3D: Multi-dataset Indoor 3D Object Detection","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2409.04234","snapshot_observed_at":"2026-08-15T18:19:43.661984Z","title":"UniDet3D: Multi-dataset indoor 3d object detection","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.18331","last_updated":"2025-07-24T11:58:01Z","snapshot_observed_at":"2026-08-18T18:52:22.629116Z","submitted_at":"2025-07-24T11:58:01Z","title":"Boosting Multi-View Indoor 3D Object Detection via Adaptive 3D Volume Construction","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-15T18:19:43.661984Z"},"links":{"cited_paper":"/paper/2409.04234","citing_paper":"/paper/2507.18331"},"observation_digest":"sha256:b87c02a25882bd538e7ee4bd1860eadbd3872d86ae7296cd6cc7a596e6063f06","observation_id":"aa9126a0-7f33-4cd2-96fb-abf6338dbb08","resolution":{"observed_at":"2026-08-15T18:19:43.661984Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T18:19:44.190903Z","title":"DFA3D: 3d deformable attention for 2d-to-3d feature lifting","venue":null,"work_id":"d128bf2d-4dd7-4cad-85ea-77997caf0762","year":2023},"citing_paper":{"arxiv_id":"2507.18331","last_updated":"2025-07-24T11:58:01Z","snapshot_observed_at":"2026-08-18T18:52:22.629116Z","submitted_at":"2025-07-24T11:58:01Z","title":"Boosting Multi-View Indoor 3D Object Detection via Adaptive 3D Volume Construction","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-15T18:19:43.665669Z"},"links":{"citing_paper":"/paper/2507.18331"},"observation_digest":"sha256:99a2ed5295b975ce8145847fae897661e35c9e4b960eaac727a3aba00921b90e","observation_id":"abc0bbd7-7425-4e61-9a34-bc982aa7a266","resolution":{"observed_at":"2026-08-15T18:19:44.195516Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2506.04623","last_updated":"2025-06-05T04:31:55Z","snapshot_observed_at":"2026-08-15T12:36:15.010641Z","submitted_at":"2025-06-05T04:31:55Z","title":"VoxDet: Rethinking 3D Semantic Occupancy Prediction as Dense Object Detection","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2506.04623","snapshot_observed_at":"2026-08-15T18:19:43.669437Z","title":"V oxDet: Re- thinking 3d semantic occupancy prediction as dense object detection","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2507.18331","last_updated":"2025-07-24T11:58:01Z","snapshot_observed_at":"2026-08-18T18:52:22.629116Z","submitted_at":"2025-07-24T11:58:01Z","title":"Boosting Multi-View Indoor 3D Object Detection via Adaptive 3D Volume Construction","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-15T18:19:43.669437Z"},"links":{"cited_paper":"/paper/2506.04623","citing_paper":"/paper/2507.18331"},"observation_digest":"sha256:ff255996ad7a912d5f5d0c702431ef49b6bfff0e98cdfa5a25615dad37a7918e","observation_id":"9a41abaf-2be6-423c-b6dd-53d242239b6b","resolution":{"observed_at":"2026-08-15T18:19:43.669437Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T18:19:44.179341Z","title":"BEVDepth: Acquisition of reliable depth for multi-view 3d object detec- tion","venue":null,"work_id":"3c86f27c-b6c6-4356-9228-7d00e47e9533","year":2023},"citing_paper":{"arxiv_id":"2507.18331","last_updated":"2025-07-24T11:58:01Z","snapshot_observed_at":"2026-08-18T18:52:22.629116Z","submitted_at":"2025-07-24T11:58:01Z","title":"Boosting Multi-View Indoor 3D Object Detection via Adaptive 3D Volume Construction","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-15T18:19:43.673938Z"},"links":{"citing_paper":"/paper/2507.18331"},"observation_digest":"sha256:bfa23276f47cd5678778a693a8ebc0cad8ee8b2b3604949f37ac43c97c54e2f1","observation_id":"5956a0b1-c958-4136-8571-c6361e00a16b","resolution":{"observed_at":"2026-08-15T18:19:44.183560Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T18:19:44.168750Z","title":"V oxFormer: Sparse voxel transformer for camera- based 3d semantic scene completion","venue":null,"work_id":"813aa340-7bc2-4263-857a-7d3611b61d2f","year":2023},"citing_paper":{"arxiv_id":"2507.18331","last_updated":"2025-07-24T11:58:01Z","snapshot_observed_at":"2026-08-18T18:52:22.629116Z","submitted_at":"2025-07-24T11:58:01Z","title":"Boosting Multi-View Indoor 3D Object Detection via Adaptive 3D Volume Construction","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-15T18:19:43.677167Z"},"links":{"citing_paper":"/paper/2507.18331"},"observation_digest":"sha256:4dbbecb8b5c6880c0c5b9488f0390dc286d51535a1e4e487b81441f9aff078dd","observation_id":"d21a3c97-1116-4653-a8f9-42a57a67dcc3","resolution":{"observed_at":"2026-08-15T18:19:44.172344Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T18:19:44.157253Z","title":"BEVFormer: Learning bird’s-eye-view representation from lidar-camera via spatiotemporal transformers","venue":null,"work_id":"41efe0ba-8909-4c9c-81e7-11510ea2672e","year":2024},"citing_paper":{"arxiv_id":"2507.18331","last_updated":"2025-07-24T11:58:01Z","snapshot_observed_at":"2026-08-18T18:52:22.629116Z","submitted_at":"2025-07-24T11:58:01Z","title":"Boosting Multi-View Indoor 3D Object Detection via Adaptive 3D Volume Construction","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-15T18:19:43.680324Z"},"links":{"citing_paper":"/paper/2507.18331"},"observation_digest":"sha256:a5aa82447d313c78e60009361baf8062973ba56ec20b08517ebe99f820b93e19","observation_id":"4db7cc86-732d-4dfc-ac46-fed5729689df","resolution":{"observed_at":"2026-08-15T18:19:44.162018Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T18:19:44.145933Z","title":"GO-N3RDet: Geometry opti- mized nerf-enhanced 3d object detector","venue":null,"work_id":"9a4e6e79-3940-4026-9df4-8d60e61f1af4","year":2025},"citing_paper":{"arxiv_id":"2507.18331","last_updated":"2025-07-24T11:58:01Z","snapshot_observed_at":"2026-08-18T18:52:22.629116Z","submitted_at":"2025-07-24T11:58:01Z","title":"Boosting Multi-View Indoor 3D Object Detection via Adaptive 3D Volume Construction","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-15T18:19:43.683615Z"},"links":{"citing_paper":"/paper/2507.18331"},"observation_digest":"sha256:ee858f3241df0112530937ae588197e4f7a3a6cdb0e002c03cb3fe7953dc17f8","observation_id":"0e8c5d07-1ff0-4b0b-89b9-21ccd4a707db","resolution":{"observed_at":"2026-08-15T18:19:44.150427Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2401.07477","last_updated":"2024-01-15T05:10:27Z","snapshot_observed_at":"2026-08-19T01:04:38.300593Z","submitted_at":"2024-01-15T05:10:27Z","title":"CascadeV-Det: Cascade Point Voting for 3D Object Detection","version":1},"cited_work":{"arxiv_id":"2401.07477","doi":null,"metadata_source":"pith","pith_arxiv_id":"2401.07477","snapshot_observed_at":"2026-08-15T18:19:43.836645Z","title":"CascadeV-Det: Cascade Point Voting for 3D Object Detection","venue":"cs.CV","work_id":"f040b5cc-8524-4f82-bc7a-46e7912c994a","year":2024},"citing_paper":{"arxiv_id":"2507.18331","last_updated":"2025-07-24T11:58:01Z","snapshot_observed_at":"2026-08-18T18:52:22.629116Z","submitted_at":"2025-07-24T11:58:01Z","title":"Boosting Multi-View Indoor 3D Object Detection via Adaptive 3D Volume Construction","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-15T18:19:43.686821Z"},"links":{"cited_paper":"/paper/2401.07477","citing_paper":"/paper/2507.18331"},"observation_digest":"sha256:ed015ac9c087bc49369a2ca76c71149d70f115c01db50df30a26f5bd631cf03b","observation_id":"e6dca1ba-2e33-4f2f-a130-22bd2bd8bd14","resolution":{"observed_at":"2026-08-15T18:19:43.842521Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T18:19:44.134238Z","title":"Feature pyramid networks for object detection","venue":null,"work_id":"6dc29429-79d6-467d-9210-b19994b83083","year":2017},"citing_paper":{"arxiv_id":"2507.18331","last_updated":"2025-07-24T11:58:01Z","snapshot_observed_at":"2026-08-18T18:52:22.629116Z","submitted_at":"2025-07-24T11:58:01Z","title":"Boosting Multi-View Indoor 3D Object Detection via Adaptive 3D Volume Construction","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-15T18:19:43.690261Z"},"links":{"citing_paper":"/paper/2507.18331"},"observation_digest":"sha256:6a0a32cad108ee2bef274cc38d6e299c1626a83accad3f590cb27806d52404f2","observation_id":"5db0572c-1543-46bb-ac3c-4fe09fd76408","resolution":{"observed_at":"2026-08-15T18:19:44.138596Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T18:19:44.123718Z","title":"SparseBEV: High-performance sparse 3d object de- tection from multi-camera videos","venue":null,"work_id":"97edd438-4009-4d26-972b-c6268c6d3c51","year":2023},"citing_paper":{"arxiv_id":"2507.18331","last_updated":"2025-07-24T11:58:01Z","snapshot_observed_at":"2026-08-18T18:52:22.629116Z","submitted_at":"2025-07-24T11:58:01Z","title":"Boosting Multi-View Indoor 3D Object Detection via Adaptive 3D Volume Construction","version":1},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-15T18:19:43.693223Z"},"links":{"citing_paper":"/paper/2507.18331"},"observation_digest":"sha256:ddd535b261a911099c1c92d574590dcfa6ae58a4170742f8f84dd1b1e5b02484","observation_id":"2e750016-6751-4ff3-8f6a-aa5b3f1d724a","resolution":{"observed_at":"2026-08-15T18:19:44.127557Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T18:19:44.113887Z","title":"Fully sparse 3d occupancy prediction","venue":null,"work_id":"7d46d2ec-5487-49de-a65f-5e81991d0c50","year":2024},"citing_paper":{"arxiv_id":"2507.18331","last_updated":"2025-07-24T11:58:01Z","snapshot_observed_at":"2026-08-18T18:52:22.629116Z","submitted_at":"2025-07-24T11:58:01Z","title":"Boosting Multi-View Indoor 3D Object Detection via Adaptive 3D Volume Construction","version":1},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-15T18:19:43.696665Z"},"links":{"citing_paper":"/paper/2507.18331"},"observation_digest":"sha256:6defd39578f6409bc04c8022f72119105c0765728a096c674703a1dbde34ed83","observation_id":"4aa453ce-c816-47a3-aed3-9194716cc3ff","resolution":{"observed_at":"2026-08-15T18:19:44.117309Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T18:19:44.103090Z","title":"PETR: Position embedding transformation for multi-view 3d object detection","venue":null,"work_id":"d22f571f-5d9d-4748-8c72-68200d06c18c","year":2022},"citing_paper":{"arxiv_id":"2507.18331","last_updated":"2025-07-24T11:58:01Z","snapshot_observed_at":"2026-08-18T18:52:22.629116Z","submitted_at":"2025-07-24T11:58:01Z","title":"Boosting Multi-View Indoor 3D Object Detection via Adaptive 3D Volume Construction","version":1},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-15T18:19:43.699989Z"},"links":{"citing_paper":"/paper/2507.18331"},"observation_digest":"sha256:ade6e60f7888c90ba27e7fa2b2c1d21407f7ff8a92d8308b5c7a4454a99ebb07","observation_id":"66174b45-ede6-49bc-aa7d-12d34f682187","resolution":{"observed_at":"2026-08-15T18:19:44.107122Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1608.03983","last_updated":"2017-05-03T16:28:09Z","snapshot_observed_at":"2026-07-06T05:06:55.589962Z","submitted_at":"2016-08-13T13:46:05Z","title":"SGDR: Stochastic Gradient Descent with Warm Restarts","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1608.03983","snapshot_observed_at":"2026-08-15T18:19:43.703218Z","title":"SGDR: Stochas- tic gradient descent with warm restarts","venue":null,"work_id":null,"year":2016},"citing_paper":{"arxiv_id":"2507.18331","last_updated":"2025-07-24T11:58:01Z","snapshot_observed_at":"2026-08-18T18:52:22.629116Z","submitted_at":"2025-07-24T11:58:01Z","title":"Boosting Multi-View Indoor 3D Object Detection via Adaptive 3D Volume Construction","version":1},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-15T18:19:43.703218Z"},"links":{"cited_paper":"/paper/1608.03983","citing_paper":"/paper/2507.18331"},"observation_digest":"sha256:bffcae9d405c8dfc47d556ee8654032fa015450852dcfef5857990fb853dd0dc","observation_id":"6f469e3d-2756-41f7-8cdd-c0cafa5aa9ff","resolution":{"observed_at":"2026-08-15T18:19:43.703218Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1711.05101","last_updated":"2019-01-04T21:01:49Z","snapshot_observed_at":"2026-08-14T20:13:52.872565Z","submitted_at":"2017-11-14T14:24:06Z","title":"Decoupled Weight Decay Regularization","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1711.05101","snapshot_observed_at":"2026-08-15T18:19:43.706805Z","title":"Decoupled weight decay regularization","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2507.18331","last_updated":"2025-07-24T11:58:01Z","snapshot_observed_at":"2026-08-18T18:52:22.629116Z","submitted_at":"2025-07-24T11:58:01Z","title":"Boosting Multi-View Indoor 3D Object Detection via Adaptive 3D Volume Construction","version":1},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-15T18:19:43.706805Z"},"links":{"cited_paper":"/paper/1711.05101","citing_paper":"/paper/2507.18331"},"observation_digest":"sha256:3e25a2652a823ae742a498726bbcdb09df21a8509f1743704d6bb77415402729","observation_id":"e1560505-822f-48ac-ad29-0c3820536142","resolution":{"observed_at":"2026-08-15T18:19:43.706805Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T18:19:44.093099Z","title":"Oc- treeOcc: Efficient and multi-granularity occupancy predic- tion using octree queries","venue":null,"work_id":"8db015c0-8a2d-4574-a9b1-60c19abbc807","year":2024},"citing_paper":{"arxiv_id":"2507.18331","last_updated":"2025-07-24T11:58:01Z","snapshot_observed_at":"2026-08-18T18:52:22.629116Z","submitted_at":"2025-07-24T11:58:01Z","title":"Boosting Multi-View Indoor 3D Object Detection via Adaptive 3D Volume Construction","version":1},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-08-15T18:19:43.710096Z"},"links":{"citing_paper":"/paper/2507.18331"},"observation_digest":"sha256:19238e0c3e6f89e1e69939c23759582865fa4bf20da287d24c11f49472e6d4e0","observation_id":"9ea7fa02-9f5a-4bdb-9656-e61103b445bc","resolution":{"observed_at":"2026-08-15T18:19:44.096518Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T18:19:44.082168Z","title":"Deep hough voting for 3d object detection in point clouds","venue":null,"work_id":"105446f5-6924-43f1-8ceb-9cff6a05f6b7","year":2019},"citing_paper":{"arxiv_id":"2507.18331","last_updated":"2025-07-24T11:58:01Z","snapshot_observed_at":"2026-08-18T18:52:22.629116Z","submitted_at":"2025-07-24T11:58:01Z","title":"Boosting Multi-View Indoor 3D Object Detection via Adaptive 3D Volume Construction","version":1},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-08-15T18:19:43.714161Z"},"links":{"citing_paper":"/paper/2507.18331"},"observation_digest":"sha256:c095f434f3c103bbf12eb17dac21bb6a155ef848abbfc14df5d39cc4b47f0e43","observation_id":"6a95996b-5dc1-485d-b619-7c02df888c3b","resolution":{"observed_at":"2026-08-15T18:19:44.086639Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T18:19:43.718174Z","title":"Language- grounded indoor 3d semantic segmentation in the wild","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2507.18331","last_updated":"2025-07-24T11:58:01Z","snapshot_observed_at":"2026-08-18T18:52:22.629116Z","submitted_at":"2025-07-24T11:58:01Z","title":"Boosting Multi-View Indoor 3D Object Detection via Adaptive 3D Volume Construction","version":1},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-08-15T18:19:43.718174Z"},"links":{"citing_paper":"/paper/2507.18331"},"observation_digest":"sha256:f230b76fe415e9c4778be0b856e39f27cecbd08dc1fdd8503b99846168204e75","observation_id":"d3c5df1d-a52c-4866-a2a5-efb4e4bf05ae","resolution":{"observed_at":"2026-08-15T18:19:43.718174Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T18:19:44.066702Z","title":"FCAF3D: Fully convolutional anchor-free 3d object detec- tion","venue":null,"work_id":"1152e5c0-4988-4b5a-9c93-7de51d9955a9","year":2022},"citing_paper":{"arxiv_id":"2507.18331","last_updated":"2025-07-24T11:58:01Z","snapshot_observed_at":"2026-08-18T18:52:22.629116Z","submitted_at":"2025-07-24T11:58:01Z","title":"Boosting Multi-View Indoor 3D Object Detection via Adaptive 3D Volume Construction","version":1},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-08-15T18:19:43.721460Z"},"links":{"citing_paper":"/paper/2507.18331"},"observation_digest":"sha256:8428ee3917b8a42e1623b45dc7c1f503fa11c923bb03aea749314567f8527d37","observation_id":"161f481c-1d0c-4f0d-a02e-9e3bbc2d6eb7","resolution":{"observed_at":"2026-08-15T18:19:44.070164Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T18:19:44.056502Z","title":"ImV oxelNet: Image to voxels projection for monocular and multi-view general-purpose 3d object detection","venue":null,"work_id":"ad1ed4a0-63af-4dca-907d-1f7821109f98","year":2022},"citing_paper":{"arxiv_id":"2507.18331","last_updated":"2025-07-24T11:58:01Z","snapshot_observed_at":"2026-08-18T18:52:22.629116Z","submitted_at":"2025-07-24T11:58:01Z","title":"Boosting Multi-View Indoor 3D Object Detection via Adaptive 3D Volume Construction","version":1},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-08-15T18:19:43.724963Z"},"links":{"citing_paper":"/paper/2507.18331"},"observation_digest":"sha256:8d5c6fb20126c5d1c147569f2f808360057ae69954041cb179d2d409f2d91252","observation_id":"656d4941-5da4-4543-9bbc-697a407240c6","resolution":{"observed_at":"2026-08-15T18:19:44.060175Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T18:19:44.044741Z","title":"CN-RMA: Combined network with ray marching aggrega- tion for 3d indoor object detection from multi-view images","venue":null,"work_id":"a973d987-c818-4f43-89b8-600b2b4013b0","year":2024},"citing_paper":{"arxiv_id":"2507.18331","last_updated":"2025-07-24T11:58:01Z","snapshot_observed_at":"2026-08-18T18:52:22.629116Z","submitted_at":"2025-07-24T11:58:01Z","title":"Boosting Multi-View Indoor 3D Object Detection via Adaptive 3D Volume Construction","version":1},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-08-15T18:19:43.728281Z"},"links":{"citing_paper":"/paper/2507.18331"},"observation_digest":"sha256:a1df4ccdbe408ec07600356f09822ffd1c788ba2f6a54fcb0e5fcaf9229eb0e4","observation_id":"eb9192f1-80dc-4929-a5b9-364992fcde9a","resolution":{"observed_at":"2026-08-15T18:19:44.049849Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T18:19:44.034137Z","title":"Im- GeoNet: Image-induced geometry-aware voxel representa- tion for multi-view 3d object detection","venue":null,"work_id":"dd6ceeb7-61ca-4d64-8a20-41073485b4a3","year":2023},"citing_paper":{"arxiv_id":"2507.18331","last_updated":"2025-07-24T11:58:01Z","snapshot_observed_at":"2026-08-18T18:52:22.629116Z","submitted_at":"2025-07-24T11:58:01Z","title":"Boosting Multi-View Indoor 3D Object Detection via Adaptive 3D Volume Construction","version":1},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-08-15T18:19:43.732622Z"},"links":{"citing_paper":"/paper/2507.18331"},"observation_digest":"sha256:c0aa8736661177bbd65e0c3ceaf94c5dce24eeee2cb07569a9d4bafc708ceac5","observation_id":"dfff186b-5d02-4615-bbc7-bbfbdc68a26b","resolution":{"observed_at":"2026-08-15T18:19:44.038016Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T18:19:44.021879Z","title":"CA- Group3D: Class-aware grouping for 3d object detection on point clouds","venue":null,"work_id":"3fa78863-4ff7-4841-982d-6b1c01cfacd8","year":2022},"citing_paper":{"arxiv_id":"2507.18331","last_updated":"2025-07-24T11:58:01Z","snapshot_observed_at":"2026-08-18T18:52:22.629116Z","submitted_at":"2025-07-24T11:58:01Z","title":"Boosting Multi-View Indoor 3D Object Detection via Adaptive 3D Volume Construction","version":1},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-08-15T18:19:43.735851Z"},"links":{"citing_paper":"/paper/2507.18331"},"observation_digest":"sha256:8760cd4f69687bf856efeefc812887baea9d275d41e9803c5d38cd9590f2649f","observation_id":"52c1815b-234e-456a-aeff-da7457c1d12c","resolution":{"observed_at":"2026-08-15T18:19:44.026338Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T18:19:44.010863Z","title":"OPUS: Occupancy prediction using a sparse set","venue":null,"work_id":"90e2c555-5d63-4ac0-af39-39d9955cf4c8","year":2024},"citing_paper":{"arxiv_id":"2507.18331","last_updated":"2025-07-24T11:58:01Z","snapshot_observed_at":"2026-08-18T18:52:22.629116Z","submitted_at":"2025-07-24T11:58:01Z","title":"Boosting Multi-View Indoor 3D Object Detection via Adaptive 3D Volume Construction","version":1},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-08-15T18:19:43.739140Z"},"links":{"citing_paper":"/paper/2507.18331"},"observation_digest":"sha256:4b8794e41fa045859902419a861fd9207573e1f8fe0787b45fe10aa815287cc9","observation_id":"da89db84-621b-48f6-8e89-477d60c7943c","resolution":{"observed_at":"2026-08-15T18:19:44.014299Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T18:19:43.999161Z","title":"EmbodiedScan: A holistic multi- modal 3d perception suite towards embodied AI","venue":null,"work_id":"6b9b5b1c-7b97-4522-adcd-918f536840f6","year":2024},"citing_paper":{"arxiv_id":"2507.18331","last_updated":"2025-07-24T11:58:01Z","snapshot_observed_at":"2026-08-18T18:52:22.629116Z","submitted_at":"2025-07-24T11:58:01Z","title":"Boosting Multi-View Indoor 3D Object Detection via Adaptive 3D Volume Construction","version":1},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-08-15T18:19:43.742367Z"},"links":{"citing_paper":"/paper/2507.18331"},"observation_digest":"sha256:6f2ae26006a3e25259f1c4f54033ab47e2ee52a671463b3b8da5c8f83d495ead","observation_id":"a0f73c7a-51e6-4acd-bd19-184aed544d0c","resolution":{"observed_at":"2026-08-15T18:19:44.002828Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T18:19:43.988209Z","title":"DETR3D: 3d object detection from multi-view images via 3d-to-2d queries","venue":null,"work_id":"a0cb6cef-4121-4c29-8bbe-69682aab2608","year":null},"citing_paper":{"arxiv_id":"2507.18331","last_updated":"2025-07-24T11:58:01Z","snapshot_observed_at":"2026-08-18T18:52:22.629116Z","submitted_at":"2025-07-24T11:58:01Z","title":"Boosting Multi-View Indoor 3D Object Detection via Adaptive 3D Volume Construction","version":1},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-08-15T18:19:43.746582Z"},"links":{"citing_paper":"/paper/2507.18331"},"observation_digest":"sha256:07948616da3b5b25782644825dff1ab2e0584ff0b54828c68a79589d048fafb6","observation_id":"77eb54a6-1578-4448-a9e9-ad789959d202","resolution":{"observed_at":"2026-08-15T18:19:43.992553Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T18:19:43.977443Z","title":"Attention is all you need","venue":null,"work_id":"b963d4b6-d347-42b5-a694-8187cc08a0b6","year":2017},"citing_paper":{"arxiv_id":"2507.18331","last_updated":"2025-07-24T11:58:01Z","snapshot_observed_at":"2026-08-18T18:52:22.629116Z","submitted_at":"2025-07-24T11:58:01Z","title":"Boosting Multi-View Indoor 3D Object Detection via Adaptive 3D Volume Construction","version":1},"reference_index":36,"source":"pdf_text","source_observed_at":"2026-08-15T18:19:43.750444Z"},"links":{"citing_paper":"/paper/2507.18331"},"observation_digest":"sha256:973a9211650d90482207bc89804dba926898c8a2760c630f512a878081d1320b","observation_id":"e34383c4-80c0-4bf1-b66a-504161d38455","resolution":{"observed_at":"2026-08-15T18:19:43.981300Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T18:19:43.966431Z","title":"Pixel-aligned recurrent queries for multi-view 3d object detection","venue":null,"work_id":"5ce63ab9-5491-4a90-ade7-010f84d3577f","year":null},"citing_paper":{"arxiv_id":"2507.18331","last_updated":"2025-07-24T11:58:01Z","snapshot_observed_at":"2026-08-18T18:52:22.629116Z","submitted_at":"2025-07-24T11:58:01Z","title":"Boosting Multi-View Indoor 3D Object Detection via Adaptive 3D Volume Construction","version":1},"reference_index":37,"source":"pdf_text","source_observed_at":"2026-08-15T18:19:43.754280Z"},"links":{"citing_paper":"/paper/2507.18331"},"observation_digest":"sha256:ea04ccd01a5e4f9a5854f8584ddc51de4ce2663912ee416215783c50355a3113","observation_id":"a1569dcf-dc0a-43ed-8f26-4fe66b556e32","resolution":{"observed_at":"2026-08-15T18:19:43.970296Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T18:19:43.955163Z","title":"NeRF-Det: Learning geometry-aware volumetric representation for multi-view 3d object detection","venue":null,"work_id":"393c1cd3-dd4f-44ce-95c7-dab8728e0cc0","year":null},"citing_paper":{"arxiv_id":"2507.18331","last_updated":"2025-07-24T11:58:01Z","snapshot_observed_at":"2026-08-18T18:52:22.629116Z","submitted_at":"2025-07-24T11:58:01Z","title":"Boosting Multi-View Indoor 3D Object Detection via Adaptive 3D Volume Construction","version":1},"reference_index":38,"source":"pdf_text","source_observed_at":"2026-08-15T18:19:43.757725Z"},"links":{"citing_paper":"/paper/2507.18331"},"observation_digest":"sha256:079f3d39e1468722be26219ee4e9cfd2e2b0e2728ba685327e2ef7a1efcd199d","observation_id":"16183f49-ee0c-4c03-9673-6b115103dfd8","resolution":{"observed_at":"2026-08-15T18:19:43.959268Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T18:19:43.937082Z","title":"Unifying flow, stereo and depth estimation","venue":null,"work_id":"94c2571c-1a2f-4575-aadd-0d8523957530","year":2023},"citing_paper":{"arxiv_id":"2507.18331","last_updated":"2025-07-24T11:58:01Z","snapshot_observed_at":"2026-08-18T18:52:22.629116Z","submitted_at":"2025-07-24T11:58:01Z","title":"Boosting Multi-View Indoor 3D Object Detection via Adaptive 3D Volume Construction","version":1},"reference_index":39,"source":"pdf_text","source_observed_at":"2026-08-15T18:19:43.764637Z"},"links":{"citing_paper":"/paper/2507.18331"},"observation_digest":"sha256:58e8c772e950e1adee650d4a74e2491d047c491db191860ab758890bc1d8564a","observation_id":"aab3ae61-3671-4cd8-9996-90a1a380dd41","resolution":{"observed_at":"2026-08-15T18:19:43.941402Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T18:19:43.925737Z","title":"MVSDet: Multi- view indoor 3d object detection via efficient plane sweeps","venue":null,"work_id":"20cb6f71-8bfc-4bf7-8025-e3e84be94422","year":2024},"citing_paper":{"arxiv_id":"2507.18331","last_updated":"2025-07-24T11:58:01Z","snapshot_observed_at":"2026-08-18T18:52:22.629116Z","submitted_at":"2025-07-24T11:58:01Z","title":"Boosting Multi-View Indoor 3D Object Detection via Adaptive 3D Volume Construction","version":1},"reference_index":40,"source":"pdf_text","source_observed_at":"2026-08-15T18:19:43.768056Z"},"links":{"citing_paper":"/paper/2507.18331"},"observation_digest":"sha256:8304ac4115741ae71e70018d3140e73e5865b2e5a3f2bcdd71da75190624720b","observation_id":"402b0588-40b0-433c-b66a-b8999abb7279","resolution":{"observed_at":"2026-08-15T18:19:43.929570Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T18:19:43.915415Z","title":"MVSNet: Depth inference for unstructured multi- view stereo","venue":null,"work_id":"34ecb040-21f8-48e8-9224-90e6f8eb4d80","year":2018},"citing_paper":{"arxiv_id":"2507.18331","last_updated":"2025-07-24T11:58:01Z","snapshot_observed_at":"2026-08-18T18:52:22.629116Z","submitted_at":"2025-07-24T11:58:01Z","title":"Boosting Multi-View Indoor 3D Object Detection via Adaptive 3D Volume Construction","version":1},"reference_index":41,"source":"pdf_text","source_observed_at":"2026-08-15T18:19:43.772661Z"},"links":{"citing_paper":"/paper/2507.18331"},"observation_digest":"sha256:bb96d904dba15fc84ec7b736ebc474b9d12b95a67158ee40b9c9b96ac312ffa8","observation_id":"1f2fb457-35e3-4890-b48c-97d2ede8f69d","resolution":{"observed_at":"2026-08-15T18:19:43.918972Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T18:19:43.902733Z","title":"Context and geometry aware voxel transformer for semantic scene completion","venue":null,"work_id":"e8682fd2-e5f6-48d8-931c-1a0d64f6b182","year":2024},"citing_paper":{"arxiv_id":"2507.18331","last_updated":"2025-07-24T11:58:01Z","snapshot_observed_at":"2026-08-18T18:52:22.629116Z","submitted_at":"2025-07-24T11:58:01Z","title":"Boosting Multi-View Indoor 3D Object Detection via Adaptive 3D Volume Construction","version":1},"reference_index":42,"source":"pdf_text","source_observed_at":"2026-08-15T18:19:43.776468Z"},"links":{"citing_paper":"/paper/2507.18331"},"observation_digest":"sha256:a15beea155e6c1ea25f26e778ff3d6cf98db81f933ecf5d920b6cbf92dc14b87","observation_id":"077bbc2f-64b5-447d-9263-654229fd2320","resolution":{"observed_at":"2026-08-15T18:19:43.907844Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T18:19:43.890222Z","title":"H3DNet: 3d object detection using hybrid geometric prim- itives","venue":null,"work_id":"7a6c57fb-a056-4bc3-880e-73cbeb722861","year":2020},"citing_paper":{"arxiv_id":"2507.18331","last_updated":"2025-07-24T11:58:01Z","snapshot_observed_at":"2026-08-18T18:52:22.629116Z","submitted_at":"2025-07-24T11:58:01Z","title":"Boosting Multi-View Indoor 3D Object Detection via Adaptive 3D Volume Construction","version":1},"reference_index":43,"source":"pdf_text","source_observed_at":"2026-08-15T18:19:43.779994Z"},"links":{"citing_paper":"/paper/2507.18331"},"observation_digest":"sha256:850610ab8da51ba079249dfeeb2280f805a7f3dc92dd727e1c3b2a7707fa87f5","observation_id":"a70232c2-60cf-4043-974e-9dbc2130329d","resolution":{"observed_at":"2026-08-15T18:19:43.895048Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T18:19:43.761346Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2507.18331","last_updated":"2025-07-24T11:58:01Z","snapshot_observed_at":"2026-08-18T18:52:22.629116Z","submitted_at":"2025-07-24T11:58:01Z","title":"Boosting Multi-View Indoor 3D Object Detection via Adaptive 3D Volume Construction","version":1},"reference_index":2023,"source":"pdf_text","source_observed_at":"2026-08-15T18:19:43.761346Z"},"links":{"citing_paper":"/paper/2507.18331"},"observation_digest":"sha256:4d2c74377c957029678cc7d142b838b4e9a317456370035d330d8f3a8837532a","observation_id":"501fbb30-549c-4080-9105-6aacf674fd2c","resolution":{"observed_at":"2026-08-15T18:19:43.761346Z","resolver_source":null,"status":"parse_uncertain"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"paper":{"arxiv_id":"2507.18331","last_updated":"2025-07-24T11:58:01Z","latest_version":1,"primary_category":"cs.CV","snapshot_observed_at":"2026-08-18T18:52:22.629116Z","submitted_at":"2025-07-24T11:58:01Z","title":"Boosting Multi-View Indoor 3D Object Detection via Adaptive 3D Volume Construction"},"reference_resolution":{"displayed":44,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":1,"unresolved":9,"verified_exact":1,"verified_fuzzy":33},"total_outbound_references":44},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"thesis":"As of 21 August 2026, this Paper Citation Record lists 44 of 44 outbound references and 0 inbound Pith citation observations for arXiv:2507.18331."}