{"as_of":"2026-08-20T16:22:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:96a715fac242a84292b2c382c35692199c25968f60ff7e4afd383712e3d39905","coverage":[{"denominator":43,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":43,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-07T04:35:23.777947Z","state":"measured"},{"denominator":43,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":43,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-20T06:33:59.587034+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2506.10242/citation-record","integrity":"/paper/2506.10242/integrity","json":"/paper/2506.10242/citation-record.json","paper":"/paper/2506.10242"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:35:24.310299Z","title":"Z-forcing: Training stochastic recurrent networks","venue":null,"work_id":"ed9834ed-e3af-41df-9f87-86409765d700","year":null},"citing_paper":{"arxiv_id":"2506.10242","last_updated":"2025-06-11T23:49:56Z","snapshot_observed_at":"2026-08-13T13:53:22.502423Z","submitted_at":"2025-06-11T23:49:56Z","title":"DySS: Dynamic Queries and State-Space Learning for Efficient 3D Object Detection from Multi-Camera Videos","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-07T04:35:23.629194Z"},"links":{"citing_paper":"/paper/2506.10242"},"observation_digest":"sha256:300728c1f2a17d4454d94f64d5d7edfa1cacaf539b3fba186ec360234c3a3dfc","observation_id":"8abcc4ae-5bd8-497d-986b-f29347edaba6","resolution":{"observed_at":"2026-08-07T04:35:24.313515Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:35:24.301100Z","title":"nuscenes: A multi- modal dataset for autonomous driving","venue":null,"work_id":"71ea8e00-2bb3-481f-87f8-90f7cdf378ac","year":2020},"citing_paper":{"arxiv_id":"2506.10242","last_updated":"2025-06-11T23:49:56Z","snapshot_observed_at":"2026-08-13T13:53:22.502423Z","submitted_at":"2025-06-11T23:49:56Z","title":"DySS: Dynamic Queries and State-Space Learning for Efficient 3D Object Detection from Multi-Camera Videos","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-07T04:35:23.632780Z"},"links":{"citing_paper":"/paper/2506.10242"},"observation_digest":"sha256:de867ef575be3a0f503c681be31e4d7a85ef4067ddc3236d36ecdc7eb8f87c2b","observation_id":"ff8814c9-257e-43c3-b423-4a781febe005","resolution":{"observed_at":"2026-08-07T04:35:24.304718Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:35:24.292213Z","title":"End-to- end object detection with transformers","venue":null,"work_id":"2df16d2b-7b82-455c-9c4e-af4125349723","year":2020},"citing_paper":{"arxiv_id":"2506.10242","last_updated":"2025-06-11T23:49:56Z","snapshot_observed_at":"2026-08-13T13:53:22.502423Z","submitted_at":"2025-06-11T23:49:56Z","title":"DySS: Dynamic Queries and State-Space Learning for Efficient 3D Object Detection from Multi-Camera Videos","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-07T04:35:23.636302Z"},"links":{"citing_paper":"/paper/2506.10242"},"observation_digest":"sha256:d1c7c069a4efb8420fcfcbb4feba6138ac2db19799ed55d3fe63e9847ce5a262","observation_id":"00a75295-8a3c-4782-b297-c9b9655c3f1b","resolution":{"observed_at":"2026-08-07T04:35:24.295481Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2403.09626","last_updated":"2024-03-14T17:57:07Z","snapshot_observed_at":"2026-08-16T14:09:43.089136Z","submitted_at":"2024-03-14T17:57:07Z","title":"Video Mamba Suite: State Space Model as a Versatile Alternative for Video Understanding","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2403.09626","snapshot_observed_at":"2026-08-07T04:35:23.639725Z","title":"Video mamba suite: State space model as a ver- satile alternative for video understanding","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.10242","last_updated":"2025-06-11T23:49:56Z","snapshot_observed_at":"2026-08-13T13:53:22.502423Z","submitted_at":"2025-06-11T23:49:56Z","title":"DySS: Dynamic Queries and State-Space Learning for Efficient 3D Object Detection from Multi-Camera Videos","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-07T04:35:23.639725Z"},"links":{"cited_paper":"/paper/2403.09626","citing_paper":"/paper/2506.10242"},"observation_digest":"sha256:213a80dc0ec820a6579e372ba6b4f7d2a5e02845418b2e8fa8c521cea5afa8df","observation_id":"d2b5b1d6-47b0-4bf8-afd0-2402e801fb73","resolution":{"observed_at":"2026-08-07T04:35:23.639725Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:35:24.283239Z","title":"Adamixer: A fast-converging query-based object detector","venue":null,"work_id":"1c754ede-9b9a-4414-bcdf-961aee14ebf8","year":2022},"citing_paper":{"arxiv_id":"2506.10242","last_updated":"2025-06-11T23:49:56Z","snapshot_observed_at":"2026-08-13T13:53:22.502423Z","submitted_at":"2025-06-11T23:49:56Z","title":"DySS: Dynamic Queries and State-Space Learning for Efficient 3D Object Detection from Multi-Camera Videos","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-07T04:35:23.643131Z"},"links":{"citing_paper":"/paper/2506.10242"},"observation_digest":"sha256:f4634f0e554bee524661ac3873baefb8dd2b84fdd4300314e60bf68e3b961930","observation_id":"72982439-0b0f-472f-916d-58515dc24776","resolution":{"observed_at":"2026-08-07T04:35:24.286582Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2312.00752","last_updated":"2024-05-31T17:55:27Z","snapshot_observed_at":"2026-08-17T20:47:46.242385Z","submitted_at":"2023-12-01T18:01:34Z","title":"Mamba: Linear-Time Sequence Modeling with Selective State Spaces","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2312.00752","snapshot_observed_at":"2026-08-07T04:35:23.650763Z","title":"Mamba: Linear-time sequence modeling with selective state spaces","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.10242","last_updated":"2025-06-11T23:49:56Z","snapshot_observed_at":"2026-08-13T13:53:22.502423Z","submitted_at":"2025-06-11T23:49:56Z","title":"DySS: Dynamic Queries and State-Space Learning for Efficient 3D Object Detection from Multi-Camera Videos","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-07T04:35:23.650763Z"},"links":{"cited_paper":"/paper/2312.00752","citing_paper":"/paper/2506.10242"},"observation_digest":"sha256:b7c20a09673da175c0327d632fbc3c1bae9b3669afc887e59df1fb615ea6383b","observation_id":"072cf3c4-d079-4339-963f-eb65167fe5e2","resolution":{"observed_at":"2026-08-07T04:35:23.650763Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2111.00396","last_updated":"2022-08-05T17:54:38Z","snapshot_observed_at":"2026-08-14T01:02:41.198730Z","submitted_at":"2021-10-31T03:32:18Z","title":"Efficiently Modeling Long Sequences with Structured State Spaces","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2111.00396","snapshot_observed_at":"2026-08-07T04:35:23.653942Z","title":"Efficiently modeling long sequences with structured state spaces","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2506.10242","last_updated":"2025-06-11T23:49:56Z","snapshot_observed_at":"2026-08-13T13:53:22.502423Z","submitted_at":"2025-06-11T23:49:56Z","title":"DySS: Dynamic Queries and State-Space Learning for Efficient 3D Object Detection from Multi-Camera Videos","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-07T04:35:23.653942Z"},"links":{"cited_paper":"/paper/2111.00396","citing_paper":"/paper/2506.10242"},"observation_digest":"sha256:885beaffca3126f14bda5a6829932e9718617a8af17cf5aa944301fca11becea","observation_id":"63ae3aee-01c3-463a-ba75-06aba72a5d6d","resolution":{"observed_at":"2026-08-07T04:35:23.653942Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:35:23.657336Z","title":"Deep residual learning for image recognition","venue":null,"work_id":null,"year":2016},"citing_paper":{"arxiv_id":"2506.10242","last_updated":"2025-06-11T23:49:56Z","snapshot_observed_at":"2026-08-13T13:53:22.502423Z","submitted_at":"2025-06-11T23:49:56Z","title":"DySS: Dynamic Queries and State-Space Learning for Efficient 3D Object Detection from Multi-Camera Videos","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-07T04:35:23.657336Z"},"links":{"citing_paper":"/paper/2506.10242"},"observation_digest":"sha256:ebeb64e89638e8355029ce608dfe7c0df80509da4a607b39316f7a123e123ab2","observation_id":"ae16e8a2-4e0a-442d-8e03-373b9931890a","resolution":{"observed_at":"2026-08-07T04:35:23.657336Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2203.17054","last_updated":"2022-06-16T09:44:08Z","snapshot_observed_at":"2026-08-16T17:10:15.129652Z","submitted_at":"2022-03-31T14:21:19Z","title":"BEVDet4D: Exploit Temporal Cues in Multi-camera 3D Object Detection","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2203.17054","snapshot_observed_at":"2026-08-07T04:35:23.660995Z","title":"Bevdet4d: Exploit tempo- ral cues in multi-camera 3d object detection","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2506.10242","last_updated":"2025-06-11T23:49:56Z","snapshot_observed_at":"2026-08-13T13:53:22.502423Z","submitted_at":"2025-06-11T23:49:56Z","title":"DySS: Dynamic Queries and State-Space Learning for Efficient 3D Object Detection from Multi-Camera Videos","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-07T04:35:23.660995Z"},"links":{"cited_paper":"/paper/2203.17054","citing_paper":"/paper/2506.10242"},"observation_digest":"sha256:ee1d3cf195612ba5b19de472477fb45cde9784849447eb3eec491c7fcf2b746a","observation_id":"0fabe1e0-660c-48a4-b6ff-2cceceddac60","resolution":{"observed_at":"2026-08-07T04:35:23.660995Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2211.17111","last_updated":"2022-11-30T15:55:38Z","snapshot_observed_at":"2026-08-19T04:54:15.276763Z","submitted_at":"2022-11-30T15:55:38Z","title":"BEVPoolv2: A Cutting-edge Implementation of BEVDet Toward Deployment","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2211.17111","snapshot_observed_at":"2026-08-07T04:35:23.664114Z","title":"Bevpoolv2: A cutting-edge implementation of bevdet toward deployment.arXiv preprint arXiv:2211.17111, 2022","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2506.10242","last_updated":"2025-06-11T23:49:56Z","snapshot_observed_at":"2026-08-13T13:53:22.502423Z","submitted_at":"2025-06-11T23:49:56Z","title":"DySS: Dynamic Queries and State-Space Learning for Efficient 3D Object Detection from Multi-Camera Videos","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-07T04:35:23.664114Z"},"links":{"cited_paper":"/paper/2211.17111","citing_paper":"/paper/2506.10242"},"observation_digest":"sha256:22b9ba3518cce9a507a30575fbbbef8a8fbc9b6eda2402659bd4e632c170a9fd","observation_id":"9cf04c9f-8c4a-4f0f-8f32-235010ec904a","resolution":{"observed_at":"2026-08-07T04:35:23.664114Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2112.11790","last_updated":"2022-06-16T09:15:52Z","snapshot_observed_at":"2026-08-17T05:15:58.663240Z","submitted_at":"2021-12-22T10:48:06Z","title":"BEVDet: High-performance Multi-camera 3D Object Detection in Bird-Eye-View","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2112.11790","snapshot_observed_at":"2026-08-07T04:35:23.667697Z","title":"Bevdet: High-performance multi-camera 3d object de- tection in bird-eye-view","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2506.10242","last_updated":"2025-06-11T23:49:56Z","snapshot_observed_at":"2026-08-13T13:53:22.502423Z","submitted_at":"2025-06-11T23:49:56Z","title":"DySS: Dynamic Queries and State-Space Learning for Efficient 3D Object Detection from Multi-Camera Videos","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-07T04:35:23.667697Z"},"links":{"cited_paper":"/paper/2112.11790","citing_paper":"/paper/2506.10242"},"observation_digest":"sha256:6701b744634339a11c536298f4d96bafaa3a9910790c88fdb23a3cd3a152fa63","observation_id":"6b5c54e6-2cea-436f-a06a-6ea7aa32d0d4","resolution":{"observed_at":"2026-08-07T04:35:23.667697Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:35:24.268543Z","title":"Leveraging vision-centric multi-modal expertise for 3d object detection","venue":null,"work_id":"1ec4b1a1-b3d7-4b40-bade-9dd486147050","year":null},"citing_paper":{"arxiv_id":"2506.10242","last_updated":"2025-06-11T23:49:56Z","snapshot_observed_at":"2026-08-13T13:53:22.502423Z","submitted_at":"2025-06-11T23:49:56Z","title":"DySS: Dynamic Queries and State-Space Learning for Efficient 3D Object Detection from Multi-Camera Videos","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-07T04:35:23.671194Z"},"links":{"citing_paper":"/paper/2506.10242"},"observation_digest":"sha256:77939ea83f604b4bacb44341a703a903a491b4dd2ef4f19c793984a4285003c2","observation_id":"aaf6c6e3-ad8e-4a31-87f5-c700edf0e74e","resolution":{"observed_at":"2026-08-07T04:35:24.271836Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:35:24.258927Z","title":"Polarformer: Multi- camera 3d object detection with polar transformer","venue":null,"work_id":"2f569f98-2ec5-4165-a642-13be9eac18cf","year":2023},"citing_paper":{"arxiv_id":"2506.10242","last_updated":"2025-06-11T23:49:56Z","snapshot_observed_at":"2026-08-13T13:53:22.502423Z","submitted_at":"2025-06-11T23:49:56Z","title":"DySS: Dynamic Queries and State-Space Learning for Efficient 3D Object Detection from Multi-Camera Videos","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-07T04:35:23.675385Z"},"links":{"citing_paper":"/paper/2506.10242"},"observation_digest":"sha256:1cdb3807dafbb4a63d160730a7da88c8089cdad30f4ebabb4cc653553d1e9b3e","observation_id":"90608fdf-c32b-43da-a9c3-1e8f73556615","resolution":{"observed_at":"2026-08-07T04:35:24.262437Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:35:24.248871Z","title":"Centermask: Real- time anchor-free instance segmentation","venue":null,"work_id":"81bcebe9-3fd1-45f8-84a9-c9e5c5d9903d","year":2020},"citing_paper":{"arxiv_id":"2506.10242","last_updated":"2025-06-11T23:49:56Z","snapshot_observed_at":"2026-08-13T13:53:22.502423Z","submitted_at":"2025-06-11T23:49:56Z","title":"DySS: Dynamic Queries and State-Space Learning for Efficient 3D Object Detection from Multi-Camera Videos","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-07T04:35:23.679220Z"},"links":{"citing_paper":"/paper/2506.10242"},"observation_digest":"sha256:84fec025e0d48863be0f1521a628846746d9d6db9aae1a06a08c4bf549e1fa8d","observation_id":"552a9ca0-bc53-46ff-8b5e-0ac4cdfe7d7a","resolution":{"observed_at":"2026-08-07T04:35:24.252214Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2403.06977","last_updated":"2024-03-12T15:22:52Z","snapshot_observed_at":"2026-08-16T14:10:51.584702Z","submitted_at":"2024-03-11T17:59:34Z","title":"VideoMamba: State Space Model for Efficient Video Understanding","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2403.06977","snapshot_observed_at":"2026-08-07T04:35:23.682312Z","title":"Videomamba: State space model for efficient video understanding","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.10242","last_updated":"2025-06-11T23:49:56Z","snapshot_observed_at":"2026-08-13T13:53:22.502423Z","submitted_at":"2025-06-11T23:49:56Z","title":"DySS: Dynamic Queries and State-Space Learning for Efficient 3D Object Detection from Multi-Camera Videos","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-07T04:35:23.682312Z"},"links":{"cited_paper":"/paper/2403.06977","citing_paper":"/paper/2506.10242"},"observation_digest":"sha256:f4c91345ef94ee3209e6f41792a1a3386e5f8192ca0ff67f9b0f9bd66fae73cd","observation_id":"03a5c6c0-ad48-4a67-be9d-51d07e94ec7f","resolution":{"observed_at":"2026-08-07T04:35:23.682312Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:35:24.238955Z","title":"Unifying voxel-based representation with transformer for 3d object detection","venue":null,"work_id":"93f78aa2-15e9-4f8c-81e8-b188f30127cc","year":2022},"citing_paper":{"arxiv_id":"2506.10242","last_updated":"2025-06-11T23:49:56Z","snapshot_observed_at":"2026-08-13T13:53:22.502423Z","submitted_at":"2025-06-11T23:49:56Z","title":"DySS: Dynamic Queries and State-Space Learning for Efficient 3D Object Detection from Multi-Camera Videos","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-07T04:35:23.686094Z"},"links":{"citing_paper":"/paper/2506.10242"},"observation_digest":"sha256:47012d7ff476b81f7d088c9017f067b6229ca870437520aa0728460b5db1a8c2","observation_id":"a5653bad-36d0-470b-aa78-782cb74e9dfd","resolution":{"observed_at":"2026-08-07T04:35:24.242284Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:35:24.228674Z","title":"Bevstereo: Enhancing depth estimation in multi-view 3d object detection with temporal stereo","venue":null,"work_id":"b4fcdd5a-c4df-4e13-9979-d60f353c0afc","year":2023},"citing_paper":{"arxiv_id":"2506.10242","last_updated":"2025-06-11T23:49:56Z","snapshot_observed_at":"2026-08-13T13:53:22.502423Z","submitted_at":"2025-06-11T23:49:56Z","title":"DySS: Dynamic Queries and State-Space Learning for Efficient 3D Object Detection from Multi-Camera Videos","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-07T04:35:23.689354Z"},"links":{"citing_paper":"/paper/2506.10242"},"observation_digest":"sha256:9011385372b9c0a87c49745af788293bb2d2bc9beef8e6c7c962a5ca75142e24","observation_id":"898d26c0-a53e-40aa-8407-e36678c0114b","resolution":{"observed_at":"2026-08-07T04:35:24.232330Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:35:24.219655Z","title":"Bevdepth: Acquisition of reliable depth for multi-view 3d object detec- tion","venue":null,"work_id":"195a6c43-bdb1-43b4-bcb4-2d158fab73a7","year":2023},"citing_paper":{"arxiv_id":"2506.10242","last_updated":"2025-06-11T23:49:56Z","snapshot_observed_at":"2026-08-13T13:53:22.502423Z","submitted_at":"2025-06-11T23:49:56Z","title":"DySS: Dynamic Queries and State-Space Learning for Efficient 3D Object Detection from Multi-Camera Videos","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-07T04:35:23.693042Z"},"links":{"citing_paper":"/paper/2506.10242"},"observation_digest":"sha256:cae8dc73756f25e456fcb8e1f8de8f282f7191aec4e22ae2dfb5d6dcae8c0801","observation_id":"d2c88619-72eb-446e-84b6-371ab67aa6ab","resolution":{"observed_at":"2026-08-07T04:35:24.222857Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:35:24.210707Z","title":"Bevformer: Learning bird’s-eye-view representation from multi-camera images via spatiotemporal transformers","venue":null,"work_id":"c5ad3db7-d325-48f2-8759-b7ddc234186a","year":2022},"citing_paper":{"arxiv_id":"2506.10242","last_updated":"2025-06-11T23:49:56Z","snapshot_observed_at":"2026-08-13T13:53:22.502423Z","submitted_at":"2025-06-11T23:49:56Z","title":"DySS: Dynamic Queries and State-Space Learning for Efficient 3D Object Detection from Multi-Camera Videos","version":1},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-07T04:35:23.696321Z"},"links":{"citing_paper":"/paper/2506.10242"},"observation_digest":"sha256:f91826de0a1dbe0da0278fb15853b31095593a9f21c1a5d9e296efc25e853f64","observation_id":"376b5c64-a8c1-4d66-9b7f-6a753f60a4c9","resolution":{"observed_at":"2026-08-07T04:35:24.214004Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:35:24.201296Z","title":"Bevnext: Reviving dense bev frameworks for 3d object de- tection","venue":null,"work_id":"5d9dc7aa-efff-41d6-87ec-fc7ef8a99339","year":2024},"citing_paper":{"arxiv_id":"2506.10242","last_updated":"2025-06-11T23:49:56Z","snapshot_observed_at":"2026-08-13T13:53:22.502423Z","submitted_at":"2025-06-11T23:49:56Z","title":"DySS: Dynamic Queries and State-Space Learning for Efficient 3D Object Detection from Multi-Camera Videos","version":1},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-07T04:35:23.699476Z"},"links":{"citing_paper":"/paper/2506.10242"},"observation_digest":"sha256:df4628175147ab33fb2c6d8b3c75e0fa2c40eb115b72556d3a8622bc0a33b93a","observation_id":"2cea3e93-9536-48fb-a519-210cb9e6b785","resolution":{"observed_at":"2026-08-07T04:35:24.204687Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2211.10581","last_updated":"2023-02-10T05:47:05Z","snapshot_observed_at":"2026-08-16T16:14:57.237141Z","submitted_at":"2022-11-19T04:20:57Z","title":"Sparse4D: Multi-view 3D Object Detection with Sparse Spatial-Temporal Fusion","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2211.10581","snapshot_observed_at":"2026-08-07T04:35:23.703406Z","title":"Sparse4d: Multi-view 3d object detec- tion with sparse spatial-temporal fusion","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2506.10242","last_updated":"2025-06-11T23:49:56Z","snapshot_observed_at":"2026-08-13T13:53:22.502423Z","submitted_at":"2025-06-11T23:49:56Z","title":"DySS: Dynamic Queries and State-Space Learning for Efficient 3D Object Detection from Multi-Camera Videos","version":1},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-07T04:35:23.703406Z"},"links":{"cited_paper":"/paper/2211.10581","citing_paper":"/paper/2506.10242"},"observation_digest":"sha256:bb053340f84e0c72deace9b41754ec156bf7e2974bb75084a207ab4ea899ff61","observation_id":"6be02f11-7fa4-40b4-ac06-aaf02d211a87","resolution":{"observed_at":"2026-08-07T04:35:23.703406Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2305.14018","last_updated":"2023-05-24T04:00:55Z","snapshot_observed_at":"2026-08-18T05:28:30.614555Z","submitted_at":"2023-05-23T12:53:58Z","title":"Sparse4D v2: Recurrent Temporal Fusion with Sparse Model","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2305.14018","snapshot_observed_at":"2026-08-07T04:35:23.707571Z","title":"Sparse4d v2: Recurrent temporal fusion with sparse model","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.10242","last_updated":"2025-06-11T23:49:56Z","snapshot_observed_at":"2026-08-13T13:53:22.502423Z","submitted_at":"2025-06-11T23:49:56Z","title":"DySS: Dynamic Queries and State-Space Learning for Efficient 3D Object Detection from Multi-Camera Videos","version":1},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-07T04:35:23.707571Z"},"links":{"cited_paper":"/paper/2305.14018","citing_paper":"/paper/2506.10242"},"observation_digest":"sha256:822e0ea83dafcaaa6ca06af13703f620d71734a392b33881a1a8c2bb69351a0e","observation_id":"71262ffe-2505-487d-ae8a-3456c748107b","resolution":{"observed_at":"2026-08-07T04:35:23.707571Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2402.03634","last_updated":"2024-03-12T07:38:34Z","snapshot_observed_at":"2026-08-16T14:21:11.205535Z","submitted_at":"2024-02-06T02:17:44Z","title":"Ray Denoising: Depth-aware Hard Negative Sampling for Multi-view 3D Object Detection","version":2},"cited_work":{"arxiv_id":"2402.03634","doi":null,"metadata_source":"pith","pith_arxiv_id":"2402.03634","snapshot_observed_at":"2026-08-07T04:35:23.878217Z","title":"Ray Denoising: Depth-aware Hard Negative Sampling for Multi-view 3D Object Detection","venue":"cs.CV","work_id":"0cefc5f8-b43d-42f5-aaff-f33a1a150c93","year":2024},"citing_paper":{"arxiv_id":"2506.10242","last_updated":"2025-06-11T23:49:56Z","snapshot_observed_at":"2026-08-13T13:53:22.502423Z","submitted_at":"2025-06-11T23:49:56Z","title":"DySS: Dynamic Queries and State-Space Learning for Efficient 3D Object Detection from Multi-Camera Videos","version":1},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-07T04:35:23.710929Z"},"links":{"cited_paper":"/paper/2402.03634","citing_paper":"/paper/2506.10242"},"observation_digest":"sha256:adb718a223c03b096509dc5d9d64516bc75ca6e2cdba293944f35545633a0374","observation_id":"dfa006e2-065c-4f5f-ab7e-891dc5cab592","resolution":{"observed_at":"2026-08-07T04:35:23.884066Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:35:24.192229Z","title":"Sparsebev: High-performance sparse 3d object de- tection from multi-camera videos","venue":null,"work_id":"a04bcfef-36b5-4324-8847-2729abb474ce","year":2023},"citing_paper":{"arxiv_id":"2506.10242","last_updated":"2025-06-11T23:49:56Z","snapshot_observed_at":"2026-08-13T13:53:22.502423Z","submitted_at":"2025-06-11T23:49:56Z","title":"DySS: Dynamic Queries and State-Space Learning for Efficient 3D Object Detection from Multi-Camera Videos","version":1},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-08-07T04:35:23.714318Z"},"links":{"citing_paper":"/paper/2506.10242"},"observation_digest":"sha256:f677360d25306b58dcc7cae3144350d4225a720f911b1f56cb890c33aee3e319","observation_id":"381d2629-124c-4b34-ad60-c7da18e7324d","resolution":{"observed_at":"2026-08-07T04:35:24.195665Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:35:24.182495Z","title":"Petr: Position embedding transformation for multi-view 3d object detection","venue":null,"work_id":"9a815626-ec71-4647-b5a0-0f86b1563d42","year":2022},"citing_paper":{"arxiv_id":"2506.10242","last_updated":"2025-06-11T23:49:56Z","snapshot_observed_at":"2026-08-13T13:53:22.502423Z","submitted_at":"2025-06-11T23:49:56Z","title":"DySS: Dynamic Queries and State-Space Learning for Efficient 3D Object Detection from Multi-Camera Videos","version":1},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-08-07T04:35:23.717576Z"},"links":{"citing_paper":"/paper/2506.10242"},"observation_digest":"sha256:676646f573d9228345c0a8d4a9d1f0e1c3afebfd87614238b54c9aefbf3579e1","observation_id":"b1e2e4a1-68cf-4148-b0d7-19e5d0f63fbc","resolution":{"observed_at":"2026-08-07T04:35:24.185889Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:35:24.171699Z","title":"Petrv2: A unified framework for 3d perception from multi-camera images","venue":null,"work_id":"8db74017-738d-40f4-9d75-a5d7cf162dae","year":2023},"citing_paper":{"arxiv_id":"2506.10242","last_updated":"2025-06-11T23:49:56Z","snapshot_observed_at":"2026-08-13T13:53:22.502423Z","submitted_at":"2025-06-11T23:49:56Z","title":"DySS: Dynamic Queries and State-Space Learning for Efficient 3D Object Detection from Multi-Camera Videos","version":1},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-08-07T04:35:23.721298Z"},"links":{"citing_paper":"/paper/2506.10242"},"observation_digest":"sha256:5e6ffa9f1ca792b38a46ad33b06450ed57f6098111dcfe11eb46b314e707b5d2","observation_id":"43cdd979-3738-4025-8915-e45aa45801cc","resolution":{"observed_at":"2026-08-07T04:35:24.175069Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2401.10166","last_updated":"2024-12-29T14:57:13Z","snapshot_observed_at":"2026-08-17T14:56:56.233298Z","submitted_at":"2024-01-18T17:55:39Z","title":"VMamba: Visual State Space Model","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2401.10166","snapshot_observed_at":"2026-08-07T04:35:23.724665Z","title":"Vmamba: Visual state space model","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2506.10242","last_updated":"2025-06-11T23:49:56Z","snapshot_observed_at":"2026-08-13T13:53:22.502423Z","submitted_at":"2025-06-11T23:49:56Z","title":"DySS: Dynamic Queries and State-Space Learning for Efficient 3D Object Detection from Multi-Camera Videos","version":1},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-08-07T04:35:23.724665Z"},"links":{"cited_paper":"/paper/2401.10166","citing_paper":"/paper/2506.10242"},"observation_digest":"sha256:663e0ddbc00bd0fe77e0706c66ceebbb2060dcce805eed0815fe2d0d9f3fd517","observation_id":"ff040686-4235-4740-89bb-e593e723f301","resolution":{"observed_at":"2026-08-07T04:35:23.724665Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2407.18232","last_updated":"2024-07-25T17:50:32Z","snapshot_observed_at":"2026-08-16T13:31:00.088677Z","submitted_at":"2024-07-25T17:50:32Z","title":"LION: Linear Group RNN for 3D Object Detection in Point Clouds","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2407.18232","snapshot_observed_at":"2026-08-07T04:35:23.728353Z","title":"Lion: Linear group rnn for 3d object detection in point clouds","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.10242","last_updated":"2025-06-11T23:49:56Z","snapshot_observed_at":"2026-08-13T13:53:22.502423Z","submitted_at":"2025-06-11T23:49:56Z","title":"DySS: Dynamic Queries and State-Space Learning for Efficient 3D Object Detection from Multi-Camera Videos","version":1},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-08-07T04:35:23.728353Z"},"links":{"cited_paper":"/paper/2407.18232","citing_paper":"/paper/2506.10242"},"observation_digest":"sha256:81c35ca52cf9ed00d37369433197e40bdec641ee25f7b5cb68b3ff73e88bf060","observation_id":"f7600ef8-104e-4a9a-862d-ff40f676d13b","resolution":{"observed_at":"2026-08-07T04:35:23.728353Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:35:24.161438Z","title":"Is pseudo-lidar needed for monocular 3d object detection? In Proceedings of the IEEE/CVF Inter- national Conference on Computer Vision, pages 3142–3152,","venue":null,"work_id":"f7e4df1d-5254-438e-83f8-ae0432f6f3c4","year":null},"citing_paper":{"arxiv_id":"2506.10242","last_updated":"2025-06-11T23:49:56Z","snapshot_observed_at":"2026-08-13T13:53:22.502423Z","submitted_at":"2025-06-11T23:49:56Z","title":"DySS: Dynamic Queries and State-Space Learning for Efficient 3D Object Detection from Multi-Camera Videos","version":1},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-08-07T04:35:23.731580Z"},"links":{"citing_paper":"/paper/2506.10242"},"observation_digest":"sha256:b0b2adc99bea2642bba330c41db59190cfaba93648b8cf5f153cf0d33345fffb","observation_id":"b3e25ff0-c383-489c-bf06-a17606c4e8e5","resolution":{"observed_at":"2026-08-07T04:35:24.165043Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:35:24.151240Z","title":"Time will tell: New outlooks and a baseline for temporal multi- view 3d object detection","venue":null,"work_id":"cba5fd6e-d282-4827-a4a2-dbae8e35c49a","year":2022},"citing_paper":{"arxiv_id":"2506.10242","last_updated":"2025-06-11T23:49:56Z","snapshot_observed_at":"2026-08-13T13:53:22.502423Z","submitted_at":"2025-06-11T23:49:56Z","title":"DySS: Dynamic Queries and State-Space Learning for Efficient 3D Object Detection from Multi-Camera Videos","version":1},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-08-07T04:35:23.735080Z"},"links":{"citing_paper":"/paper/2506.10242"},"observation_digest":"sha256:cc6cfa7d2e05841fae3d51150a2188beb4dd3aa7995e6b3bd4755accf753b856","observation_id":"41c17b56-c10d-49fc-8e8f-2de7ac7eb03e","resolution":{"observed_at":"2026-08-07T04:35:24.154869Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:35:24.141442Z","title":"Lift, splat, shoot: Encoding images from arbitrary camera rigs by implicitly unprojecting to 3d","venue":null,"work_id":"9668c8c6-8bbd-4dd0-b0bc-a8c091504f0e","year":2020},"citing_paper":{"arxiv_id":"2506.10242","last_updated":"2025-06-11T23:49:56Z","snapshot_observed_at":"2026-08-13T13:53:22.502423Z","submitted_at":"2025-06-11T23:49:56Z","title":"DySS: Dynamic Queries and State-Space Learning for Efficient 3D Object Detection from Multi-Camera Videos","version":1},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-08-07T04:35:23.738676Z"},"links":{"citing_paper":"/paper/2506.10242"},"observation_digest":"sha256:397e24751a1c39776058865a7d30b3277aa84b2faece5ce027acb1c1906963e2","observation_id":"cd05786b-db7d-4383-acb0-117340bb2384","resolution":{"observed_at":"2026-08-07T04:35:24.144677Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:35:24.131154Z","title":"Amixer: Adaptive weight mixing for self-attention free vi- sion transformers","venue":null,"work_id":"843f0e9a-9341-45b7-ad71-18b7e329563e","year":2022},"citing_paper":{"arxiv_id":"2506.10242","last_updated":"2025-06-11T23:49:56Z","snapshot_observed_at":"2026-08-13T13:53:22.502423Z","submitted_at":"2025-06-11T23:49:56Z","title":"DySS: Dynamic Queries and State-Space Learning for Efficient 3D Object Detection from Multi-Camera Videos","version":1},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-08-07T04:35:23.741820Z"},"links":{"citing_paper":"/paper/2506.10242"},"observation_digest":"sha256:e44e70251697f7e4bdb7a784d2b2287a00b9a5abb650f94af5e53476ffd89fb0","observation_id":"8312d47f-2751-4b0b-91e2-4bc6808db416","resolution":{"observed_at":"2026-08-07T04:35:24.134679Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2208.04933","last_updated":"2023-03-03T18:35:28Z","snapshot_observed_at":"2026-08-13T08:14:01.416880Z","submitted_at":"2022-08-09T17:57:43Z","title":"Simplified State Space Layers for Sequence Modeling","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2208.04933","snapshot_observed_at":"2026-08-07T04:35:23.744886Z","title":"Simplified state space layers for sequence modeling","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2506.10242","last_updated":"2025-06-11T23:49:56Z","snapshot_observed_at":"2026-08-13T13:53:22.502423Z","submitted_at":"2025-06-11T23:49:56Z","title":"DySS: Dynamic Queries and State-Space Learning for Efficient 3D Object Detection from Multi-Camera Videos","version":1},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-08-07T04:35:23.744886Z"},"links":{"cited_paper":"/paper/2208.04933","citing_paper":"/paper/2506.10242"},"observation_digest":"sha256:fd3d4012caf8f5d9f4c5b701fbb958b285c1117902f4c84d70dc7a652a0e9928","observation_id":"f943a34d-ffaf-479f-b21e-2ccb0738c025","resolution":{"observed_at":"2026-08-07T04:35:23.744886Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2102.02872","last_updated":"2021-02-11T14:55:12Z","snapshot_observed_at":"2026-08-19T21:46:34.845223Z","submitted_at":"2021-02-04T20:18:56Z","title":"Feedback in Imitation Learning: The Three Regimes of Covariate Shift","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2102.02872","snapshot_observed_at":"2026-08-07T04:35:23.748313Z","title":"Feedback in imitation learning: The three regimes of covariate shift","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2506.10242","last_updated":"2025-06-11T23:49:56Z","snapshot_observed_at":"2026-08-13T13:53:22.502423Z","submitted_at":"2025-06-11T23:49:56Z","title":"DySS: Dynamic Queries and State-Space Learning for Efficient 3D Object Detection from Multi-Camera Videos","version":1},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-08-07T04:35:23.748313Z"},"links":{"cited_paper":"/paper/2102.02872","citing_paper":"/paper/2506.10242"},"observation_digest":"sha256:8c04c814bfa26be6980ac94a51acc1c7ff7e8c9a36a221ab3ac68e29a4af8b1c","observation_id":"22e6d20e-9f48-43ba-8909-bafc9fa77582","resolution":{"observed_at":"2026-08-07T04:35:23.748313Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:35:23.751851Z","title":"Sparse r-cnn: End-to-end ob- ject detection with learnable proposals","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2506.10242","last_updated":"2025-06-11T23:49:56Z","snapshot_observed_at":"2026-08-13T13:53:22.502423Z","submitted_at":"2025-06-11T23:49:56Z","title":"DySS: Dynamic Queries and State-Space Learning for Efficient 3D Object Detection from Multi-Camera Videos","version":1},"reference_index":36,"source":"pdf_text","source_observed_at":"2026-08-07T04:35:23.751851Z"},"links":{"citing_paper":"/paper/2506.10242"},"observation_digest":"sha256:66762b074b05564492c10989f0c2cab3cac8361288ed6fb0ea994212d39597c5","observation_id":"773f210f-2485-48c6-b672-13bf217709fa","resolution":{"observed_at":"2026-08-07T04:35:23.751851Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:35:24.112908Z","title":"Exploring object-centric temporal modeling for efficient multi-view 3d object detection","venue":null,"work_id":"f56442f3-2168-4399-807b-254d029049b6","year":2023},"citing_paper":{"arxiv_id":"2506.10242","last_updated":"2025-06-11T23:49:56Z","snapshot_observed_at":"2026-08-13T13:53:22.502423Z","submitted_at":"2025-06-11T23:49:56Z","title":"DySS: Dynamic Queries and State-Space Learning for Efficient 3D Object Detection from Multi-Camera Videos","version":1},"reference_index":37,"source":"pdf_text","source_observed_at":"2026-08-07T04:35:23.754954Z"},"links":{"citing_paper":"/paper/2506.10242"},"observation_digest":"sha256:217dc1dcdc452d2013e88c36bfd25a4fc1ae1fcae0bddc8fb89baaa6093a984b","observation_id":"1cc512b2-bae8-47ff-9679-7bcf4584195e","resolution":{"observed_at":"2026-08-07T04:35:24.116419Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:35:24.102393Z","title":"Detr3d: 3d object detection from multi-view images via 3d-to-2d queries","venue":null,"work_id":"f692d482-9098-4c03-9c4d-16046913768c","year":2022},"citing_paper":{"arxiv_id":"2506.10242","last_updated":"2025-06-11T23:49:56Z","snapshot_observed_at":"2026-08-13T13:53:22.502423Z","submitted_at":"2025-06-11T23:49:56Z","title":"DySS: Dynamic Queries and State-Space Learning for Efficient 3D Object Detection from Multi-Camera Videos","version":1},"reference_index":38,"source":"pdf_text","source_observed_at":"2026-08-07T04:35:23.758083Z"},"links":{"citing_paper":"/paper/2506.10242"},"observation_digest":"sha256:8437825930c394c30ebb0a0594457ef3b2ed4ae126c116e0bc24e258bdb026c8","observation_id":"145a6662-c094-4ccf-8f7f-689f421b461c","resolution":{"observed_at":"2026-08-07T04:35:24.106135Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:35:24.091808Z","title":"Bevformer v2: Adapting modern image backbones to bird’s-eye-view recognition via perspective su- pervision","venue":null,"work_id":"7c3d3838-dbe2-480c-a093-705f55c0f11e","year":2023},"citing_paper":{"arxiv_id":"2506.10242","last_updated":"2025-06-11T23:49:56Z","snapshot_observed_at":"2026-08-13T13:53:22.502423Z","submitted_at":"2025-06-11T23:49:56Z","title":"DySS: Dynamic Queries and State-Space Learning for Efficient 3D Object Detection from Multi-Camera Videos","version":1},"reference_index":39,"source":"pdf_text","source_observed_at":"2026-08-07T04:35:23.761181Z"},"links":{"citing_paper":"/paper/2506.10242"},"observation_digest":"sha256:797477975f815904d35d9e65170a99cff906d7dea323be62d2ce456e53bfcd50","observation_id":"5c1f1d61-21c1-4b85-80ac-4925e43d6352","resolution":{"observed_at":"2026-08-07T04:35:24.095452Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:35:24.080268Z","title":"Futuredepth: Learning to predict the future improves video depth estimation","venue":null,"work_id":"f7bff509-25c3-4235-8c73-9c3772ff7b84","year":2024},"citing_paper":{"arxiv_id":"2506.10242","last_updated":"2025-06-11T23:49:56Z","snapshot_observed_at":"2026-08-13T13:53:22.502423Z","submitted_at":"2025-06-11T23:49:56Z","title":"DySS: Dynamic Queries and State-Space Learning for Efficient 3D Object Detection from Multi-Camera Videos","version":1},"reference_index":40,"source":"pdf_text","source_observed_at":"2026-08-07T04:35:23.764411Z"},"links":{"citing_paper":"/paper/2506.10242"},"observation_digest":"sha256:085833d026f68fd239ee3e08451c1c8e5873e54ae3dc4f3ff026b45563254754","observation_id":"6978be83-7ce9-40b7-8caf-c875f4e59fa7","resolution":{"observed_at":"2026-08-07T04:35:24.084632Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2406.10700","last_updated":"2024-06-18T17:49:56Z","snapshot_observed_at":"2026-08-17T01:25:45.311704Z","submitted_at":"2024-06-15T17:45:07Z","title":"Voxel Mamba: Group-Free State Space Models for Point Cloud based 3D Object Detection","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2406.10700","snapshot_observed_at":"2026-08-07T04:35:23.767553Z","title":"V oxel mamba: Group-free state space models for point cloud based 3d object detection","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.10242","last_updated":"2025-06-11T23:49:56Z","snapshot_observed_at":"2026-08-13T13:53:22.502423Z","submitted_at":"2025-06-11T23:49:56Z","title":"DySS: Dynamic Queries and State-Space Learning for Efficient 3D Object Detection from Multi-Camera Videos","version":1},"reference_index":41,"source":"pdf_text","source_observed_at":"2026-08-07T04:35:23.767553Z"},"links":{"cited_paper":"/paper/2406.10700","citing_paper":"/paper/2506.10242"},"observation_digest":"sha256:094eee476feeb20dc59267324048d83d35f4e873e75c2d4ee7bce6e6089c6aa1","observation_id":"d8f0321b-8d7e-4c0f-bbc6-d42b361ea5c3","resolution":{"observed_at":"2026-08-07T04:35:23.767553Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1908.09492","last_updated":"2019-08-26T06:27:01Z","snapshot_observed_at":"2026-08-14T21:44:27.735473Z","submitted_at":"2019-08-26T06:27:01Z","title":"Class-balanced Grouping and Sampling for Point Cloud 3D Object Detection","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1908.09492","snapshot_observed_at":"2026-08-07T04:35:23.770789Z","title":"Class-balanced grouping and sampling for point cloud 3d object detection","venue":null,"work_id":null,"year":1908},"citing_paper":{"arxiv_id":"2506.10242","last_updated":"2025-06-11T23:49:56Z","snapshot_observed_at":"2026-08-13T13:53:22.502423Z","submitted_at":"2025-06-11T23:49:56Z","title":"DySS: Dynamic Queries and State-Space Learning for Efficient 3D Object Detection from Multi-Camera Videos","version":1},"reference_index":42,"source":"pdf_text","source_observed_at":"2026-08-07T04:35:23.770789Z"},"links":{"cited_paper":"/paper/1908.09492","citing_paper":"/paper/2506.10242"},"observation_digest":"sha256:2ea88a76de64e9042e013b9cba6a34308c3b6a6fb3896cdd21bd1b9ed6609604","observation_id":"2d2795a2-1547-4d27-9d97-e9d59e7b803f","resolution":{"observed_at":"2026-08-07T04:35:23.770789Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2401.09417","last_updated":"2024-11-14T02:00:33Z","snapshot_observed_at":"2026-08-14T11:12:31.002605Z","submitted_at":"2024-01-17T18:56:18Z","title":"Vision Mamba: Efficient Visual Representation Learning with Bidirectional State Space Model","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2401.09417","snapshot_observed_at":"2026-08-07T04:35:23.774219Z","title":"Vision mamba: Efficient visual representation learning with bidirectional state space model","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.10242","last_updated":"2025-06-11T23:49:56Z","snapshot_observed_at":"2026-08-13T13:53:22.502423Z","submitted_at":"2025-06-11T23:49:56Z","title":"DySS: Dynamic Queries and State-Space Learning for Efficient 3D Object Detection from Multi-Camera Videos","version":1},"reference_index":43,"source":"pdf_text","source_observed_at":"2026-08-07T04:35:23.774219Z"},"links":{"cited_paper":"/paper/2401.09417","citing_paper":"/paper/2506.10242"},"observation_digest":"sha256:dac6c90cd82cb157c9ca6eace36ea8498bb3b7952d2b0c7fc8177eca1dab9a83","observation_id":"7506a64c-3eb8-46a9-8abc-03f141def9c0","resolution":{"observed_at":"2026-08-07T04:35:23.774219Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:35:23.982631Z","title":"Temporal enhanced training of multi-view 3d object detector via historical object prediction","venue":null,"work_id":"d122ecdd-e43e-41fc-b002-ff2666190484","year":2023},"citing_paper":{"arxiv_id":"2506.10242","last_updated":"2025-06-11T23:49:56Z","snapshot_observed_at":"2026-08-13T13:53:22.502423Z","submitted_at":"2025-06-11T23:49:56Z","title":"DySS: Dynamic Queries and State-Space Learning for Efficient 3D Object Detection from Multi-Camera Videos","version":1},"reference_index":44,"source":"pdf_text","source_observed_at":"2026-08-07T04:35:23.777947Z"},"links":{"citing_paper":"/paper/2506.10242"},"observation_digest":"sha256:6e3ef28078bd52ddcf4bd20a5eb98f7be7bc531ba6b9da6fef04072508eb8397","observation_id":"328f2d44-07b8-4ae2-a427-37310b7a8cee","resolution":{"observed_at":"2026-08-07T04:35:23.986458Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}}],"paper":{"arxiv_id":"2506.10242","last_updated":"2025-06-11T23:49:56Z","latest_version":1,"primary_category":"cs.CV","snapshot_observed_at":"2026-08-13T13:53:22.502423Z","submitted_at":"2025-06-11T23:49:56Z","title":"DySS: Dynamic Queries and State-Space Learning for Efficient 3D Object Detection from Multi-Camera Videos"},"reference_resolution":{"displayed":43,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":18,"verified_exact":1,"verified_fuzzy":24},"total_outbound_references":43},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"thesis":"As of 20 August 2026, this Paper Citation Record lists 43 of 43 outbound references and 0 inbound Pith citation observations for arXiv:2506.10242."}