{"as_of":"2026-08-21T03:58:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:ceda65144266ddf333140d1852b9f2fdfa4959d3417708d773f3db98565e9f9a","coverage":[{"denominator":95,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":95,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-06T14:48:19.411266Z","state":"measured"},{"denominator":95,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":95,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-20T06:33:59.587034+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2507.17661/citation-record","integrity":"/paper/2507.17661/integrity","json":"/paper/2507.17661/citation-record.json","paper":"/paper/2507.17661"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T14:48:16.907174Z","title":"Learning representations and generative models for 3d point clouds","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2507.17661","last_updated":"2025-07-23T16:29:45Z","snapshot_observed_at":"2026-08-15T13:33:06.202590Z","submitted_at":"2025-07-23T16:29:45Z","title":"Monocular Semantic Scene Completion via Masked Recurrent Networks","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-06T14:48:16.907174Z"},"links":{"citing_paper":"/paper/2507.17661"},"observation_digest":"sha256:69e52849559bb46de0c24d1ce1ee4ffc1f2c79c37c8d0dcc4a4bb707852203e4","observation_id":"48dcfd1a-5fc6-44f1-b68d-15a12d6bafd9","resolution":{"observed_at":"2026-08-06T14:48:16.907174Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T14:48:16.957061Z","title":"Rangevit: Towards vision transformers for 3d semantic segmentation in au- tonomous driving","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2507.17661","last_updated":"2025-07-23T16:29:45Z","snapshot_observed_at":"2026-08-15T13:33:06.202590Z","submitted_at":"2025-07-23T16:29:45Z","title":"Monocular Semantic Scene Completion via Masked Recurrent Networks","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-06T14:48:16.957061Z"},"links":{"citing_paper":"/paper/2507.17661"},"observation_digest":"sha256:cf7c4b45533d81e4f9e80463baf19eaf9ed7dbd8ffee38b368bedc1cc4e437a3","observation_id":"251dca42-ccf5-4b0c-9808-540b225e583c","resolution":{"observed_at":"2026-08-06T14:48:16.957061Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T14:48:16.966499Z","title":"Se- mantickitti: A dataset for semantic scene understanding of lidar sequences","venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2507.17661","last_updated":"2025-07-23T16:29:45Z","snapshot_observed_at":"2026-08-15T13:33:06.202590Z","submitted_at":"2025-07-23T16:29:45Z","title":"Monocular Semantic Scene Completion via Masked Recurrent Networks","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-06T14:48:16.966499Z"},"links":{"citing_paper":"/paper/2507.17661"},"observation_digest":"sha256:bbf4868b474eafd183b4dc22b13877c5f12ad3018d309ec04bf3b287ec90c39c","observation_id":"526702ca-5e11-4d11-84ad-4b999fdf441a","resolution":{"observed_at":"2026-08-06T14:48:16.966499Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T14:48:17.001941Z","title":"Adabins: Depth estimation using adaptive bins","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2507.17661","last_updated":"2025-07-23T16:29:45Z","snapshot_observed_at":"2026-08-15T13:33:06.202590Z","submitted_at":"2025-07-23T16:29:45Z","title":"Monocular Semantic Scene Completion via Masked Recurrent Networks","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-06T14:48:17.001941Z"},"links":{"citing_paper":"/paper/2507.17661"},"observation_digest":"sha256:1792d22322a3b67d337731625824ea8a7c65d08d3c603191fa2495f32c4c6dae","observation_id":"447aab46-34ce-4239-9c50-9ca6c2e5df48","resolution":{"observed_at":"2026-08-06T14:48:17.001941Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T14:48:17.106824Z","title":"Dynamiccity: Large-scale 4d oc- cupancy generation from dynamic scenes","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2507.17661","last_updated":"2025-07-23T16:29:45Z","snapshot_observed_at":"2026-08-15T13:33:06.202590Z","submitted_at":"2025-07-23T16:29:45Z","title":"Monocular Semantic Scene Completion via Masked Recurrent Networks","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-06T14:48:17.106824Z"},"links":{"citing_paper":"/paper/2507.17661"},"observation_digest":"sha256:78161203267801c6eba894b3a69fa4b59ad6e2b873c32202a5271fff53478225","observation_id":"1a710fb6-3a30-47f8-9924-f3a78099190b","resolution":{"observed_at":"2026-08-06T14:48:17.106824Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T14:48:17.155892Z","title":"Also: Automotive lidar self- supervision by occupancy estimation","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2507.17661","last_updated":"2025-07-23T16:29:45Z","snapshot_observed_at":"2026-08-15T13:33:06.202590Z","submitted_at":"2025-07-23T16:29:45Z","title":"Monocular Semantic Scene Completion via Masked Recurrent Networks","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-06T14:48:17.155892Z"},"links":{"citing_paper":"/paper/2507.17661"},"observation_digest":"sha256:00a9785d1050761c2a76df83fc8e01c4f75ecb9baf202f3cd539daff5d2a82bd","observation_id":"afbdc047-1976-4615-a5b4-5bcff04356a0","resolution":{"observed_at":"2026-08-06T14:48:17.155892Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T14:48:17.208912Z","title":"Monoscene: Monoc- ular 3d semantic scene completion","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2507.17661","last_updated":"2025-07-23T16:29:45Z","snapshot_observed_at":"2026-08-15T13:33:06.202590Z","submitted_at":"2025-07-23T16:29:45Z","title":"Monocular Semantic Scene Completion via Masked Recurrent Networks","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-06T14:48:17.208912Z"},"links":{"citing_paper":"/paper/2507.17661"},"observation_digest":"sha256:74b6c24b9a31eac27de922354746d883031dcab4116e6fd0cae604dc602e8224","observation_id":"cdc61ab5-9b11-4f8d-b226-0aa3a427c2c3","resolution":{"observed_at":"2026-08-06T14:48:17.208912Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T14:48:17.256747Z","title":"Scenerf: Self- supervised monocular 3d scene reconstruction with radiance fields","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2507.17661","last_updated":"2025-07-23T16:29:45Z","snapshot_observed_at":"2026-08-15T13:33:06.202590Z","submitted_at":"2025-07-23T16:29:45Z","title":"Monocular Semantic Scene Completion via Masked Recurrent Networks","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-06T14:48:17.256747Z"},"links":{"citing_paper":"/paper/2507.17661"},"observation_digest":"sha256:e2f75b84e260b6326c61c053aae45f4c1f693f2b419eae9e36b4ef2d63d9665c","observation_id":"2b21083c-ae66-49bc-a100-3229a5569f92","resolution":{"observed_at":"2026-08-06T14:48:17.256747Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T14:48:17.325750Z","title":"Pcam: Product of cross-attention matrices for rigid registration of point clouds","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2507.17661","last_updated":"2025-07-23T16:29:45Z","snapshot_observed_at":"2026-08-15T13:33:06.202590Z","submitted_at":"2025-07-23T16:29:45Z","title":"Monocular Semantic Scene Completion via Masked Recurrent Networks","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-06T14:48:17.325750Z"},"links":{"citing_paper":"/paper/2507.17661"},"observation_digest":"sha256:a7cb341614f067ae2baa42b337f3d54463613e621ef2a3bbe319020f91cd498c","observation_id":"1c609932-9295-4432-8e29-e06197566ac2","resolution":{"observed_at":"2026-08-06T14:48:17.325750Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T14:48:17.426935Z","title":"Pasco: Urban 3d panoptic scene completion with uncertainty aware- ness","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.17661","last_updated":"2025-07-23T16:29:45Z","snapshot_observed_at":"2026-08-15T13:33:06.202590Z","submitted_at":"2025-07-23T16:29:45Z","title":"Monocular Semantic Scene Completion via Masked Recurrent Networks","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-06T14:48:17.426935Z"},"links":{"citing_paper":"/paper/2507.17661"},"observation_digest":"sha256:f86339dcfa824454e80496b5fdb363e1a56dce98794e04a31091381bf32c9fed","observation_id":"62df9be9-a606-4e9d-b5da-57206142ab56","resolution":{"observed_at":"2026-08-06T14:48:17.426935Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T14:48:17.476952Z","title":"Building a strong pre- training baseline for universal 3d large-scale perception","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.17661","last_updated":"2025-07-23T16:29:45Z","snapshot_observed_at":"2026-08-15T13:33:06.202590Z","submitted_at":"2025-07-23T16:29:45Z","title":"Monocular Semantic Scene Completion via Masked Recurrent Networks","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-06T14:48:17.476952Z"},"links":{"citing_paper":"/paper/2507.17661"},"observation_digest":"sha256:867a63e5cb1db824edaf523e5d2cd02433ae46c8be4794c7f43805dce9ae7872","observation_id":"70ac1650-bda7-49ae-91f5-21685e722968","resolution":{"observed_at":"2026-08-06T14:48:17.476952Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T14:48:17.573576Z","title":"Sca-cnn: Spatial and channel-wise attention in convolutional networks for image captioning","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2507.17661","last_updated":"2025-07-23T16:29:45Z","snapshot_observed_at":"2026-08-15T13:33:06.202590Z","submitted_at":"2025-07-23T16:29:45Z","title":"Monocular Semantic Scene Completion via Masked Recurrent Networks","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-06T14:48:17.573576Z"},"links":{"citing_paper":"/paper/2507.17661"},"observation_digest":"sha256:6ec6761dae9fe6d3ac5db182086a9be33ece265c0e3ad8d767a412b0816af541","observation_id":"0a803a4f-23f3-439a-b359-6f61f46916e1","resolution":{"observed_at":"2026-08-06T14:48:17.573576Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T14:48:17.620565Z","title":"Towards label-free scene understanding by vision foundation models","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2507.17661","last_updated":"2025-07-23T16:29:45Z","snapshot_observed_at":"2026-08-15T13:33:06.202590Z","submitted_at":"2025-07-23T16:29:45Z","title":"Monocular Semantic Scene Completion via Masked Recurrent Networks","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-06T14:48:17.620565Z"},"links":{"citing_paper":"/paper/2507.17661"},"observation_digest":"sha256:a390d0ba24a9d5d6700bd628255f915398bbcc257ec362af5e9166ca63f3c2f9","observation_id":"8101bed2-1e9e-4a13-b308-f8c3c998602e","resolution":{"observed_at":"2026-08-06T14:48:17.620565Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T14:48:17.686229Z","title":"Clip2scene: Towards label-efficient 3d scene understanding by clip","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2507.17661","last_updated":"2025-07-23T16:29:45Z","snapshot_observed_at":"2026-08-15T13:33:06.202590Z","submitted_at":"2025-07-23T16:29:45Z","title":"Monocular Semantic Scene Completion via Masked Recurrent Networks","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-06T14:48:17.686229Z"},"links":{"citing_paper":"/paper/2507.17661"},"observation_digest":"sha256:b6b91bcedb8f922b73df0cf29c8604ac456faae08772bcbd7bdd1bc2709ef109","observation_id":"6e26ce5a-1c04-4718-b510-e4016d81dd89","resolution":{"observed_at":"2026-08-06T14:48:17.686229Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T14:48:17.737417Z","title":"3d sketch-aware semantic scene comple- tion via semi-supervised structure prior","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2507.17661","last_updated":"2025-07-23T16:29:45Z","snapshot_observed_at":"2026-08-15T13:33:06.202590Z","submitted_at":"2025-07-23T16:29:45Z","title":"Monocular Semantic Scene Completion via Masked Recurrent Networks","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-06T14:48:17.737417Z"},"links":{"citing_paper":"/paper/2507.17661"},"observation_digest":"sha256:62906ee12057fd52d5d1edafa479904c2c7ba8e99735ee985d2afb54a27d6dd1","observation_id":"755bbd5c-991b-4f29-b287-0c62a962df2b","resolution":{"observed_at":"2026-08-06T14:48:17.737417Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T14:48:22.703210Z","title":"S3cnet: A sparse semantic scene completion net- work for lidar point cloud","venue":null,"work_id":"bb547a05-0ee2-4a3c-b674-442453c30d3a","year":2021},"citing_paper":{"arxiv_id":"2507.17661","last_updated":"2025-07-23T16:29:45Z","snapshot_observed_at":"2026-08-15T13:33:06.202590Z","submitted_at":"2025-07-23T16:29:45Z","title":"Monocular Semantic Scene Completion via Masked Recurrent Networks","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-06T14:48:17.789786Z"},"links":{"citing_paper":"/paper/2507.17661"},"observation_digest":"sha256:b4592b3e9aaa1b665eda9c4bf18eff5bdc369e2f09e6338f8899ff67eea05abc","observation_id":"734a8934-88be-4280-a7da-f2dd77b64e49","resolution":{"observed_at":"2026-08-06T14:48:22.757988Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T14:48:22.586444Z","title":"Af2-s3net: Attentive feature fusion with adap- tive feature selection for sparse semantic segmentation net- work","venue":null,"work_id":"3f4fb2d1-a133-4617-8cdf-abb75ae38a44","year":2021},"citing_paper":{"arxiv_id":"2507.17661","last_updated":"2025-07-23T16:29:45Z","snapshot_observed_at":"2026-08-15T13:33:06.202590Z","submitted_at":"2025-07-23T16:29:45Z","title":"Monocular Semantic Scene Completion via Masked Recurrent Networks","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-06T14:48:17.825026Z"},"links":{"citing_paper":"/paper/2507.17661"},"observation_digest":"sha256:83cf709ede7b3ac5217aede2d3ee8dd6d22563da018e73579832d112d9c0ad44","observation_id":"2fa5f261-4692-4a00-befd-1e8e8ba3fe74","resolution":{"observed_at":"2026-08-06T14:48:22.627722Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T14:48:22.452629Z","title":"4d spatio-temporal convnets: Minkowski convolutional neu- ral networks","venue":null,"work_id":"92a848c5-bff4-4201-96e6-48782bfafcdf","year":2019},"citing_paper":{"arxiv_id":"2507.17661","last_updated":"2025-07-23T16:29:45Z","snapshot_observed_at":"2026-08-15T13:33:06.202590Z","submitted_at":"2025-07-23T16:29:45Z","title":"Monocular Semantic Scene Completion via Masked Recurrent Networks","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-06T14:48:17.869369Z"},"links":{"citing_paper":"/paper/2507.17661"},"observation_digest":"sha256:59374443b27f1246d526d9b0d21488899192d165b94176e099d1331668d226e6","observation_id":"5580e8ed-5639-4cbd-a071-6fcaf8eb1cc2","resolution":{"observed_at":"2026-08-06T14:48:22.516073Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T14:48:22.250723Z","title":"3d-r2n2: A unified approach for single and multi-view 3d object reconstruction","venue":null,"work_id":"fc452ea5-33ca-447a-b341-292a1b1e55a4","year":2016},"citing_paper":{"arxiv_id":"2507.17661","last_updated":"2025-07-23T16:29:45Z","snapshot_observed_at":"2026-08-15T13:33:06.202590Z","submitted_at":"2025-07-23T16:29:45Z","title":"Monocular Semantic Scene Completion via Masked Recurrent Networks","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-06T14:48:17.914819Z"},"links":{"citing_paper":"/paper/2507.17661"},"observation_digest":"sha256:38996ebe964a7ca3391f55d7c546daea0c6b244dbbc83c3fd8a057a3d9359db1","observation_id":"977d25eb-89cc-4d48-8a8b-db34678bb3e1","resolution":{"observed_at":"2026-08-06T14:48:22.335106Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T14:48:22.033403Z","title":"Buol: A bottom-up framework with occupancy-aware lifting for panoptic 3d scene reconstruction from a single image","venue":null,"work_id":"081310f6-c6c1-4b25-a5f1-41bd76545037","year":2023},"citing_paper":{"arxiv_id":"2507.17661","last_updated":"2025-07-23T16:29:45Z","snapshot_observed_at":"2026-08-15T13:33:06.202590Z","submitted_at":"2025-07-23T16:29:45Z","title":"Monocular Semantic Scene Completion via Masked Recurrent Networks","version":1},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-06T14:48:17.947273Z"},"links":{"citing_paper":"/paper/2507.17661"},"observation_digest":"sha256:5d0f903f6597bf241cb2e5435e1f4f51acb66652e77c5a2c0d4242fd9b96b57e","observation_id":"d1258f43-1fd8-4a7f-899c-a52a8b242755","resolution":{"observed_at":"2026-08-06T14:48:22.164932Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T14:48:21.910346Z","title":"Panoptic 3d scene reconstruction from a single rgb image","venue":null,"work_id":"51aee301-cc00-45b7-b4ea-528887832412","year":2021},"citing_paper":{"arxiv_id":"2507.17661","last_updated":"2025-07-23T16:29:45Z","snapshot_observed_at":"2026-08-15T13:33:06.202590Z","submitted_at":"2025-07-23T16:29:45Z","title":"Monocular Semantic Scene Completion via Masked Recurrent Networks","version":1},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-06T14:48:18.014960Z"},"links":{"citing_paper":"/paper/2507.17661"},"observation_digest":"sha256:fb39cbc18745ef39902c91c5aadcd6ab8d78a3cec38fc622fc82ca95c39b3885","observation_id":"28729733-025c-41c5-a72c-c7e9ec6b6564","resolution":{"observed_at":"2026-08-06T14:48:21.943090Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T14:48:21.717458Z","title":"V ote3deep: Fast ob- ject detection in 3d point clouds using efficient convolu- tional neural networks","venue":null,"work_id":"7f48d65f-91ba-4e2b-a88f-8ed8dca77b7c","year":2017},"citing_paper":{"arxiv_id":"2507.17661","last_updated":"2025-07-23T16:29:45Z","snapshot_observed_at":"2026-08-15T13:33:06.202590Z","submitted_at":"2025-07-23T16:29:45Z","title":"Monocular Semantic Scene Completion via Masked Recurrent Networks","version":1},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-06T14:48:18.089961Z"},"links":{"citing_paper":"/paper/2507.17661"},"observation_digest":"sha256:19e0bdb3983c1978726a7069f697c6044651008e8d11e464841d6f883b51853b","observation_id":"fbea67ad-7d61-4d3e-8a40-d8f583726e12","resolution":{"observed_at":"2026-08-06T14:48:21.791250Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T14:48:21.645697Z","title":"A point set generation network for 3d object reconstruction from a sin- gle image","venue":null,"work_id":"8984cfa4-f438-4155-b1e7-cce523f9dece","year":2017},"citing_paper":{"arxiv_id":"2507.17661","last_updated":"2025-07-23T16:29:45Z","snapshot_observed_at":"2026-08-15T13:33:06.202590Z","submitted_at":"2025-07-23T16:29:45Z","title":"Monocular Semantic Scene Completion via Masked Recurrent Networks","version":1},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-06T14:48:18.136015Z"},"links":{"citing_paper":"/paper/2507.17661"},"observation_digest":"sha256:5d7dbef2775e10130c4136a66513395be0045f681c89286ed0d3f444e16f1f70","observation_id":"aaa46ab6-a6cd-4581-8e7d-b4d6d0cf6e62","resolution":{"observed_at":"2026-08-06T14:48:21.676511Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T14:48:21.583244Z","title":"Are we ready for autonomous driving? the kitti vision bench- mark suite","venue":null,"work_id":"93a3f77f-6ded-4c96-89d5-83e7e690765e","year":2012},"citing_paper":{"arxiv_id":"2507.17661","last_updated":"2025-07-23T16:29:45Z","snapshot_observed_at":"2026-08-15T13:33:06.202590Z","submitted_at":"2025-07-23T16:29:45Z","title":"Monocular Semantic Scene Completion via Masked Recurrent Networks","version":1},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-06T14:48:18.211265Z"},"links":{"citing_paper":"/paper/2507.17661"},"observation_digest":"sha256:695715356dcef4ca355fa3a5dba4d7a7f230ef3002846b37ca794b10328205ea","observation_id":"cbfb0ad0-1031-446f-a0ea-7a6d3d48004e","resolution":{"observed_at":"2026-08-06T14:48:21.609526Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1706.01307","last_updated":"2017-06-05T13:25:24Z","snapshot_observed_at":"2026-08-18T11:07:05.304848Z","submitted_at":"2017-06-05T13:25:24Z","title":"Submanifold Sparse Convolutional Networks","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1706.01307","snapshot_observed_at":"2026-08-06T14:48:18.298271Z","title":"Sub- manifold sparse convolutional networks","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2507.17661","last_updated":"2025-07-23T16:29:45Z","snapshot_observed_at":"2026-08-15T13:33:06.202590Z","submitted_at":"2025-07-23T16:29:45Z","title":"Monocular Semantic Scene Completion via Masked Recurrent Networks","version":1},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-08-06T14:48:18.298271Z"},"links":{"cited_paper":"/paper/1706.01307","citing_paper":"/paper/2507.17661"},"observation_digest":"sha256:4905b8d6685fbc130ed03e2364fe85c0e6c79f3e81b5c740180b3b5e1930d3e1","observation_id":"33233272-89aa-48a4-8e6b-81b9bf712907","resolution":{"observed_at":"2026-08-06T14:48:18.298271Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T14:48:21.543080Z","title":"Scenenet: Understanding real world indoor scenes with synthetic data","venue":null,"work_id":"e659921f-db2f-419f-a81a-7ab6129851c4","year":2016},"citing_paper":{"arxiv_id":"2507.17661","last_updated":"2025-07-23T16:29:45Z","snapshot_observed_at":"2026-08-15T13:33:06.202590Z","submitted_at":"2025-07-23T16:29:45Z","title":"Monocular Semantic Scene Completion via Masked Recurrent Networks","version":1},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-08-06T14:48:18.332673Z"},"links":{"citing_paper":"/paper/2507.17661"},"observation_digest":"sha256:f04030f8579355ede1b9f0a45ca5c1cc30cd35f21e4371ca70ed098979703387","observation_id":"6f3c159e-5054-48b6-9f6c-8aeed6d320bf","resolution":{"observed_at":"2026-08-06T14:48:21.555758Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T14:48:21.493347Z","title":"Is your hd map constructor reliable under sensor corruptions? In Advances in Neural Informa- tion Processing Systems, pages 22441–22482, 2024","venue":null,"work_id":"bad4909e-4279-4eed-a434-0eb1b3b35c4c","year":2024},"citing_paper":{"arxiv_id":"2507.17661","last_updated":"2025-07-23T16:29:45Z","snapshot_observed_at":"2026-08-15T13:33:06.202590Z","submitted_at":"2025-07-23T16:29:45Z","title":"Monocular Semantic Scene Completion via Masked Recurrent Networks","version":1},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-08-06T14:48:18.392729Z"},"links":{"citing_paper":"/paper/2507.17661"},"observation_digest":"sha256:8ea2f51de530ffd782afd454a70087427bbedfb344e7062b1db1c1202029509f","observation_id":"a4842c5a-e8f6-4382-bf66-7dc59b1c4eb1","resolution":{"observed_at":"2026-08-06T14:48:21.515272Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T14:48:21.470272Z","title":"Deep residual learning for image recognition","venue":null,"work_id":"7e826d6a-9ad0-4883-8797-3811376aec02","year":2016},"citing_paper":{"arxiv_id":"2507.17661","last_updated":"2025-07-23T16:29:45Z","snapshot_observed_at":"2026-08-15T13:33:06.202590Z","submitted_at":"2025-07-23T16:29:45Z","title":"Monocular Semantic Scene Completion via Masked Recurrent Networks","version":1},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-08-06T14:48:18.450996Z"},"links":{"citing_paper":"/paper/2507.17661"},"observation_digest":"sha256:f64ca8ad7a69b8e61f1b017fc0c70a5e32104103f9ab7665487c26da34b60e02","observation_id":"0716d4b5-2977-4ce8-96ba-03f48fa43d8f","resolution":{"observed_at":"2026-08-06T14:48:21.478969Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T14:48:21.442531Z","title":"Unified 3d and 4d panoptic segmentation via dynamic shifting networks","venue":null,"work_id":"90401338-6a61-4901-aba9-da4f7c497e7e","year":2024},"citing_paper":{"arxiv_id":"2507.17661","last_updated":"2025-07-23T16:29:45Z","snapshot_observed_at":"2026-08-15T13:33:06.202590Z","submitted_at":"2025-07-23T16:29:45Z","title":"Monocular Semantic Scene Completion via Masked Recurrent Networks","version":1},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-08-06T14:48:18.542798Z"},"links":{"citing_paper":"/paper/2507.17661"},"observation_digest":"sha256:762a4be88c3f22ce8538b39b2acc6ecfc9dde90f3fe146cec29bb4351393f607","observation_id":"859b53f4-10f7-4be9-aa99-3d6d48d13fc0","resolution":{"observed_at":"2026-08-06T14:48:21.451793Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T14:48:21.419958Z","title":"Squeeze-and-excitation networks","venue":null,"work_id":"ad82ea0f-f358-4e5d-a297-5633f09bf222","year":2018},"citing_paper":{"arxiv_id":"2507.17661","last_updated":"2025-07-23T16:29:45Z","snapshot_observed_at":"2026-08-15T13:33:06.202590Z","submitted_at":"2025-07-23T16:29:45Z","title":"Monocular Semantic Scene Completion via Masked Recurrent Networks","version":1},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-08-06T14:48:18.565744Z"},"links":{"citing_paper":"/paper/2507.17661"},"observation_digest":"sha256:5e3fdf57c9ed5c2fd4147d9415263272a8020dde7db888920f7b6104be8df443","observation_id":"40c5c788-476d-4413-950a-1545d801eda6","resolution":{"observed_at":"2026-08-06T14:48:21.426288Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T14:48:21.396901Z","title":"Tri-perspective view for vision-based 3d semantic occupancy prediction","venue":null,"work_id":"c3154cc5-41a9-4b3d-aea8-5dca6e2565e0","year":2023},"citing_paper":{"arxiv_id":"2507.17661","last_updated":"2025-07-23T16:29:45Z","snapshot_observed_at":"2026-08-15T13:33:06.202590Z","submitted_at":"2025-07-23T16:29:45Z","title":"Monocular Semantic Scene Completion via Masked Recurrent Networks","version":1},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-08-06T14:48:18.613278Z"},"links":{"citing_paper":"/paper/2507.17661"},"observation_digest":"sha256:937a204cda4d84e648b45a03b5f38524697757fafc8ba4ffbd51597973635c6b","observation_id":"a77cdafc-d798-4751-b33f-04d6275403a0","resolution":{"observed_at":"2026-08-06T14:48:21.404733Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T14:48:21.378825Z","title":"Sym- phonize 3d semantic scene completion with contextual in- stance queries","venue":null,"work_id":"5959bce6-81f2-4105-93fd-03cb3f36ffae","year":2024},"citing_paper":{"arxiv_id":"2507.17661","last_updated":"2025-07-23T16:29:45Z","snapshot_observed_at":"2026-08-15T13:33:06.202590Z","submitted_at":"2025-07-23T16:29:45Z","title":"Monocular Semantic Scene Completion via Masked Recurrent Networks","version":1},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-08-06T14:48:18.713933Z"},"links":{"citing_paper":"/paper/2507.17661"},"observation_digest":"sha256:e67972b237e1dcb21d94419eff54c0a4c3ebb47340d492076e6a67d84988c7ff","observation_id":"b8f4e1d5-e163-4fa4-a4d8-89bfd214b92c","resolution":{"observed_at":"2026-08-06T14:48:21.384276Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T14:48:21.354531Z","title":"Rethinking range view representation for lidar segmentation","venue":null,"work_id":"b7d3bb00-906e-4dda-b750-c3da5aad5ad4","year":2023},"citing_paper":{"arxiv_id":"2507.17661","last_updated":"2025-07-23T16:29:45Z","snapshot_observed_at":"2026-08-15T13:33:06.202590Z","submitted_at":"2025-07-23T16:29:45Z","title":"Monocular Semantic Scene Completion via Masked Recurrent Networks","version":1},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-08-06T14:48:18.786593Z"},"links":{"citing_paper":"/paper/2507.17661"},"observation_digest":"sha256:6a6a3cfdff30cb8be8901255fda4eee522f5e78bc46ae54b5106cb8d54d5eae6","observation_id":"2478527c-65c8-4df0-871f-3aadb1bdd198","resolution":{"observed_at":"2026-08-06T14:48:21.363987Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T14:48:21.333215Z","title":"Benchmarking 3d perception robustness to common corruptions and sensor failure","venue":null,"work_id":"e9d39cc9-d064-4383-b14e-57ad56441580","year":2023},"citing_paper":{"arxiv_id":"2507.17661","last_updated":"2025-07-23T16:29:45Z","snapshot_observed_at":"2026-08-15T13:33:06.202590Z","submitted_at":"2025-07-23T16:29:45Z","title":"Monocular Semantic Scene Completion via Masked Recurrent Networks","version":1},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-08-06T14:48:18.895392Z"},"links":{"citing_paper":"/paper/2507.17661"},"observation_digest":"sha256:38ea8ee3c025227c2706f6bf2f706ea90b03cb2d88a7b0e10ab47b363a11c63f","observation_id":"f795df28-5060-45ba-8e1b-ccc0216f3525","resolution":{"observed_at":"2026-08-06T14:48:21.340211Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T14:48:21.312399Z","title":"Robo3d: Towards robust and reliable 3d perception against corruptions","venue":null,"work_id":"f736b9e3-8004-48b8-a03d-6d9743eba9c4","year":2023},"citing_paper":{"arxiv_id":"2507.17661","last_updated":"2025-07-23T16:29:45Z","snapshot_observed_at":"2026-08-15T13:33:06.202590Z","submitted_at":"2025-07-23T16:29:45Z","title":"Monocular Semantic Scene Completion via Masked Recurrent Networks","version":1},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-08-06T14:48:18.959879Z"},"links":{"citing_paper":"/paper/2507.17661"},"observation_digest":"sha256:a0ff541500083cdb1fdf6d55362b6b35d8dc5e55912fa9a610fddc9fb5e6a937","observation_id":"aad24054-2f10-4d92-8f9e-58f27c1747ed","resolution":{"observed_at":"2026-08-06T14:48:21.318131Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T14:48:21.294664Z","title":"Lasermix for semi-supervised lidar semantic segmentation","venue":null,"work_id":"dbb1fd12-b064-4764-9188-a16ea3eae958","year":2023},"citing_paper":{"arxiv_id":"2507.17661","last_updated":"2025-07-23T16:29:45Z","snapshot_observed_at":"2026-08-15T13:33:06.202590Z","submitted_at":"2025-07-23T16:29:45Z","title":"Monocular Semantic Scene Completion via Masked Recurrent Networks","version":1},"reference_index":36,"source":"pdf_text","source_observed_at":"2026-08-06T14:48:19.013550Z"},"links":{"citing_paper":"/paper/2507.17661"},"observation_digest":"sha256:3c05ac61c7d8d62e47f4c53115832644a007f50cc736577704b68091f88a2696","observation_id":"20a28033-1448-4300-862b-35006effe06f","resolution":{"observed_at":"2026-08-06T14:48:21.300395Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T14:48:21.276890Z","title":"Cottereau, and Wei Tsang Ooi","venue":null,"work_id":"dd6f375b-f668-4131-bcf4-ebe7d1178f4f","year":2023},"citing_paper":{"arxiv_id":"2507.17661","last_updated":"2025-07-23T16:29:45Z","snapshot_observed_at":"2026-08-15T13:33:06.202590Z","submitted_at":"2025-07-23T16:29:45Z","title":"Monocular Semantic Scene Completion via Masked Recurrent Networks","version":1},"reference_index":37,"source":"pdf_text","source_observed_at":"2026-08-06T14:48:19.094543Z"},"links":{"citing_paper":"/paper/2507.17661"},"observation_digest":"sha256:81d153176a7739e2a34e3ba460f40da034959627f9bf8a947548ed85ca2494fe","observation_id":"dec0a9ec-1d5f-49ab-84af-5e4f0630f6d3","resolution":{"observed_at":"2026-08-06T14:48:21.282288Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"2501.04005","doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T14:48:19.919573Z","title":"Largead: Large-scale cross-sensor data pretraining for au- tonomous driving","venue":null,"work_id":"13d8787f-7f1a-484b-bcf4-0e1a1d5bee2f","year":2025},"citing_paper":{"arxiv_id":"2507.17661","last_updated":"2025-07-23T16:29:45Z","snapshot_observed_at":"2026-08-15T13:33:06.202590Z","submitted_at":"2025-07-23T16:29:45Z","title":"Monocular Semantic Scene Completion via Masked Recurrent Networks","version":1},"reference_index":38,"source":"pdf_text","source_observed_at":"2026-08-06T14:48:19.099125Z"},"links":{"citing_paper":"/paper/2507.17661"},"observation_digest":"sha256:9e059f6f2f9533c49d817d640303bb033c29ac725d874cf6b2ee403fe4db1278","observation_id":"bbb32cdb-accc-4ca8-be0f-35ee8bf77bc6","resolution":{"observed_at":"2026-08-06T14:48:19.933795Z","resolver_source":"raw_fallback","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T14:48:21.259096Z","title":"Multi- modal data-efficient 3d scene understanding for autonomous driving","venue":null,"work_id":"52734ee3-e10d-40b4-8d0e-20141d21ab7a","year":2025},"citing_paper":{"arxiv_id":"2507.17661","last_updated":"2025-07-23T16:29:45Z","snapshot_observed_at":"2026-08-15T13:33:06.202590Z","submitted_at":"2025-07-23T16:29:45Z","title":"Monocular Semantic Scene Completion via Masked Recurrent Networks","version":1},"reference_index":39,"source":"pdf_text","source_observed_at":"2026-08-06T14:48:19.104981Z"},"links":{"citing_paper":"/paper/2507.17661"},"observation_digest":"sha256:6c9e6d7160d8d172656a1b666c33ffafb6fed9812f15cb90aa74b5dd5b870fac","observation_id":"beedc11c-2919-4df2-a243-1e029f9e156b","resolution":{"observed_at":"2026-08-06T14:48:21.264751Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T14:48:21.244218Z","title":"Hierarchical temporal context learning for camera-based semantic scene comple- tion","venue":null,"work_id":"4cecb4e8-3720-4b8d-a463-540efc66a4af","year":2024},"citing_paper":{"arxiv_id":"2507.17661","last_updated":"2025-07-23T16:29:45Z","snapshot_observed_at":"2026-08-15T13:33:06.202590Z","submitted_at":"2025-07-23T16:29:45Z","title":"Monocular Semantic Scene Completion via Masked Recurrent Networks","version":1},"reference_index":40,"source":"pdf_text","source_observed_at":"2026-08-06T14:48:19.111274Z"},"links":{"citing_paper":"/paper/2507.17661"},"observation_digest":"sha256:4bc78b5d5b183c949d4b99dc59e624106e67d6e425a67dd6264a66be3d1571e2","observation_id":"2479dd20-e8a8-4d93-b29e-ae5532f06b0d","resolution":{"observed_at":"2026-08-06T14:48:21.248516Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T14:48:21.228820Z","title":"Brgscene: Bridging stereo geometry and bev representation with reliable mutual interaction for se- mantic scene completion","venue":null,"work_id":"7b6fc86e-4d53-498e-b840-368a80338e58","year":2024},"citing_paper":{"arxiv_id":"2507.17661","last_updated":"2025-07-23T16:29:45Z","snapshot_observed_at":"2026-08-15T13:33:06.202590Z","submitted_at":"2025-07-23T16:29:45Z","title":"Monocular Semantic Scene Completion via Masked Recurrent Networks","version":1},"reference_index":41,"source":"pdf_text","source_observed_at":"2026-08-06T14:48:19.116765Z"},"links":{"citing_paper":"/paper/2507.17661"},"observation_digest":"sha256:f4371d80206d9ff9c5b5082f3d2e208150ce30dda96a7eacd608088f2010e1ce","observation_id":"36a15ca0-751d-42c7-8ab2-90ac23a5f60a","resolution":{"observed_at":"2026-08-06T14:48:21.233427Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T14:48:21.209198Z","title":"Anisotropic convolutional networks for 3d semantic scene completion","venue":null,"work_id":"acccd566-5f26-41e1-be3b-5e9270b7bdc8","year":2020},"citing_paper":{"arxiv_id":"2507.17661","last_updated":"2025-07-23T16:29:45Z","snapshot_observed_at":"2026-08-15T13:33:06.202590Z","submitted_at":"2025-07-23T16:29:45Z","title":"Monocular Semantic Scene Completion via Masked Recurrent Networks","version":1},"reference_index":42,"source":"pdf_text","source_observed_at":"2026-08-06T14:48:19.122366Z"},"links":{"citing_paper":"/paper/2507.17661"},"observation_digest":"sha256:c86de9759fd93d89f0540402d522c130304e5a4224259f19f75372e59c4fd299","observation_id":"0cf7f932-57e7-4279-8b65-bb4b069ccbb7","resolution":{"observed_at":"2026-08-06T14:48:21.214450Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T14:48:21.193949Z","title":"Less is more: Reducing task and model complexity for 3d point cloud se- mantic segmentation","venue":null,"work_id":"38a49c9c-1e5f-4642-909a-b5c26217d5d8","year":2023},"citing_paper":{"arxiv_id":"2507.17661","last_updated":"2025-07-23T16:29:45Z","snapshot_observed_at":"2026-08-15T13:33:06.202590Z","submitted_at":"2025-07-23T16:29:45Z","title":"Monocular Semantic Scene Completion via Masked Recurrent Networks","version":1},"reference_index":43,"source":"pdf_text","source_observed_at":"2026-08-06T14:48:19.127425Z"},"links":{"citing_paper":"/paper/2507.17661"},"observation_digest":"sha256:612e614da22b04fd41a44a03f468cee6a30c96e41d5efea83bb8a41cf69e6f4a","observation_id":"b06967ea-77e2-4251-88ed-63c4d0b494b0","resolution":{"observed_at":"2026-08-06T14:48:21.198442Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T14:48:21.178307Z","title":null,"venue":null,"work_id":"c1767ca4-5a7f-4b37-9412-c32175b26e14","year":2024},"citing_paper":{"arxiv_id":"2507.17661","last_updated":"2025-07-23T16:29:45Z","snapshot_observed_at":"2026-08-15T13:33:06.202590Z","submitted_at":"2025-07-23T16:29:45Z","title":"Monocular Semantic Scene Completion via Masked Recurrent Networks","version":1},"reference_index":44,"source":"pdf_text","source_observed_at":"2026-08-06T14:48:19.133493Z"},"links":{"citing_paper":"/paper/2507.17661"},"observation_digest":"sha256:8223f7515809118354f1619ed77917f5b7da59ac0de26f43cab38fd5d69fa4d9","observation_id":"10cb8cb9-d1d8-4cfc-a2fb-44b4cb1ccbfe","resolution":{"observed_at":"2026-08-06T14:48:21.182842Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2210.01784","last_updated":"2022-10-08T03:42:10Z","snapshot_observed_at":"2026-08-16T16:26:56.946908Z","submitted_at":"2022-10-04T17:54:53Z","title":"COARSE3D: Class-Prototypes for Contrastive Learning in Weakly-Supervised 3D Point Cloud Segmentation","version":2},"cited_work":{"arxiv_id":"2210.01784","doi":null,"metadata_source":"pith","pith_arxiv_id":"2210.01784","snapshot_observed_at":"2026-08-06T14:48:19.799810Z","title":"COARSE3D: Class-Prototypes for Contrastive Learning in Weakly-Supervised 3D Point Cloud Segmentation","venue":"cs.CV","work_id":"2b1bde16-4bc4-416c-a933-6c122313c3f6","year":2022},"citing_paper":{"arxiv_id":"2507.17661","last_updated":"2025-07-23T16:29:45Z","snapshot_observed_at":"2026-08-15T13:33:06.202590Z","submitted_at":"2025-07-23T16:29:45Z","title":"Monocular Semantic Scene Completion via Masked Recurrent Networks","version":1},"reference_index":45,"source":"pdf_text","source_observed_at":"2026-08-06T14:48:19.138397Z"},"links":{"cited_paper":"/paper/2210.01784","citing_paper":"/paper/2507.17661"},"observation_digest":"sha256:46b6cb5233ecd6eb6ae872288aacd731dd4e957878e41abea68857b0419365ea","observation_id":"e096a70e-e043-48f7-b898-6876a0966ba5","resolution":{"observed_at":"2026-08-06T14:48:19.812752Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T14:48:21.161824Z","title":"Seeground: See and ground for zero-shot open-vocabulary 3d visual grounding","venue":null,"work_id":"f1e9b1e7-d92e-4362-b3f6-c568019da79b","year":2025},"citing_paper":{"arxiv_id":"2507.17661","last_updated":"2025-07-23T16:29:45Z","snapshot_observed_at":"2026-08-15T13:33:06.202590Z","submitted_at":"2025-07-23T16:29:45Z","title":"Monocular Semantic Scene Completion via Masked Recurrent Networks","version":1},"reference_index":46,"source":"pdf_text","source_observed_at":"2026-08-06T14:48:19.144373Z"},"links":{"citing_paper":"/paper/2507.17661"},"observation_digest":"sha256:a65d479aa5320a3731fa7737e2f69026d31d1f87e83d1dded2d53c08c28d1021","observation_id":"d6efdd0d-a5ee-45be-bfa3-0d8f37b909a6","resolution":{"observed_at":"2026-08-06T14:48:21.166961Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T14:48:21.145803Z","title":"V oxformer: Sparse voxel transformer for camera- based 3d semantic scene completion","venue":null,"work_id":"b30fb0e5-5d86-4923-bf3c-880d3630453f","year":2023},"citing_paper":{"arxiv_id":"2507.17661","last_updated":"2025-07-23T16:29:45Z","snapshot_observed_at":"2026-08-15T13:33:06.202590Z","submitted_at":"2025-07-23T16:29:45Z","title":"Monocular Semantic Scene Completion via Masked Recurrent Networks","version":1},"reference_index":47,"source":"pdf_text","source_observed_at":"2026-08-06T14:48:19.149532Z"},"links":{"citing_paper":"/paper/2507.17661"},"observation_digest":"sha256:1502ea81235045119fb82a650288299422daa9fc5c8946f00fa33367fe060ba9","observation_id":"1b6e996c-494b-4ed8-842a-31d65659f5ac","resolution":{"observed_at":"2026-08-06T14:48:21.151295Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T14:48:21.131555Z","title":"Is your lidar placement optimized for 3d scene understanding? In Advances in Neural Information Process- ing Systems, pages 34980–35017, 2024","venue":null,"work_id":"155fb4e8-7797-4aec-9294-72886c4f53b5","year":2024},"citing_paper":{"arxiv_id":"2507.17661","last_updated":"2025-07-23T16:29:45Z","snapshot_observed_at":"2026-08-15T13:33:06.202590Z","submitted_at":"2025-07-23T16:29:45Z","title":"Monocular Semantic Scene Completion via Masked Recurrent Networks","version":1},"reference_index":48,"source":"pdf_text","source_observed_at":"2026-08-06T14:48:19.154231Z"},"links":{"citing_paper":"/paper/2507.17661"},"observation_digest":"sha256:319d56694037fa7ceadfc5b811bc3d9126717ebbc33e1ce82a4f717a03aaa60a","observation_id":"a055e9cb-dbb3-4a8d-b588-a284b637cc4e","resolution":{"observed_at":"2026-08-06T14:48:21.136223Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2211.10581","last_updated":"2023-02-10T05:47:05Z","snapshot_observed_at":"2026-08-16T16:14:57.237141Z","submitted_at":"2022-11-19T04:20:57Z","title":"Sparse4D: Multi-view 3D Object Detection with Sparse Spatial-Temporal Fusion","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2211.10581","snapshot_observed_at":"2026-08-06T14:48:19.159031Z","title":"Sparse4d: Multi-view 3d object detec- tion with sparse spatial-temporal fusion","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2507.17661","last_updated":"2025-07-23T16:29:45Z","snapshot_observed_at":"2026-08-15T13:33:06.202590Z","submitted_at":"2025-07-23T16:29:45Z","title":"Monocular Semantic Scene Completion via Masked Recurrent Networks","version":1},"reference_index":49,"source":"pdf_text","source_observed_at":"2026-08-06T14:48:19.159031Z"},"links":{"cited_paper":"/paper/2211.10581","citing_paper":"/paper/2507.17661"},"observation_digest":"sha256:908bf8f22a4af2c7c1988c9f1f44e569d3eb03a746acc1afe7234a144905b23a","observation_id":"2dd372dd-77ec-49ab-a405-34cc0db63d04","resolution":{"observed_at":"2026-08-06T14:48:19.159031Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T14:48:21.112753Z","title":"See and think: Disentangling semantic scene completion","venue":null,"work_id":"820bcc5c-875e-4e0b-9641-e31bce39512d","year":2018},"citing_paper":{"arxiv_id":"2507.17661","last_updated":"2025-07-23T16:29:45Z","snapshot_observed_at":"2026-08-15T13:33:06.202590Z","submitted_at":"2025-07-23T16:29:45Z","title":"Monocular Semantic Scene Completion via Masked Recurrent Networks","version":1},"reference_index":50,"source":"pdf_text","source_observed_at":"2026-08-06T14:48:19.163953Z"},"links":{"citing_paper":"/paper/2507.17661"},"observation_digest":"sha256:730d8a139f904fb939c6c9900cc6f41b121091c67bdd29741f47b7a8a8cef7da","observation_id":"0ad422fd-e4c8-4304-80b7-897e8fc556bc","resolution":{"observed_at":"2026-08-06T14:48:21.118997Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T14:48:21.090450Z","title":"Uniseg: A unified multi-modal li- dar segmentation network and the openpcseg codebase","venue":null,"work_id":"43e89268-61a9-41f6-969a-083822ecebc7","year":2023},"citing_paper":{"arxiv_id":"2507.17661","last_updated":"2025-07-23T16:29:45Z","snapshot_observed_at":"2026-08-15T13:33:06.202590Z","submitted_at":"2025-07-23T16:29:45Z","title":"Monocular Semantic Scene Completion via Masked Recurrent Networks","version":1},"reference_index":51,"source":"pdf_text","source_observed_at":"2026-08-06T14:48:19.169083Z"},"links":{"citing_paper":"/paper/2507.17661"},"observation_digest":"sha256:8421ca6162cd3ce3ee5c8af7c3327524bafecef05659dc9630ab3f46321e0c5b","observation_id":"792fd3a2-620a-49ac-b529-e5dc6e12f502","resolution":{"observed_at":"2026-08-06T14:48:21.097631Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T14:48:21.065319Z","title":"Segment any point cloud sequences by distilling vision foundation models","venue":null,"work_id":"0c68b4fd-c587-48b3-ae5b-0b70f7d8bb79","year":2023},"citing_paper":{"arxiv_id":"2507.17661","last_updated":"2025-07-23T16:29:45Z","snapshot_observed_at":"2026-08-15T13:33:06.202590Z","submitted_at":"2025-07-23T16:29:45Z","title":"Monocular Semantic Scene Completion via Masked Recurrent Networks","version":1},"reference_index":52,"source":"pdf_text","source_observed_at":"2026-08-06T14:48:19.174790Z"},"links":{"citing_paper":"/paper/2507.17661"},"observation_digest":"sha256:532a1c11a34e0eaaa63926b7b21dd4d774551852f66016428dc6d250967a4554","observation_id":"11543c19-d0cf-4822-9d02-383a70f6113b","resolution":{"observed_at":"2026-08-06T14:48:21.077099Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T14:48:21.047070Z","title":"Multi-space alignments towards universal lidar segmentation","venue":null,"work_id":"4df79a20-afd6-4c7a-aa98-5a8b672a215e","year":2024},"citing_paper":{"arxiv_id":"2507.17661","last_updated":"2025-07-23T16:29:45Z","snapshot_observed_at":"2026-08-15T13:33:06.202590Z","submitted_at":"2025-07-23T16:29:45Z","title":"Monocular Semantic Scene Completion via Masked Recurrent Networks","version":1},"reference_index":53,"source":"pdf_text","source_observed_at":"2026-08-06T14:48:19.181248Z"},"links":{"citing_paper":"/paper/2507.17661"},"observation_digest":"sha256:d1d477178c9628fb99f0fc85c1ac12081d0435ffd33a9fcf8228fc37dfe2493d","observation_id":"59e5396e-695b-48bc-9a6b-0f1056ccec82","resolution":{"observed_at":"2026-08-06T14:48:21.052710Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T14:48:21.030281Z","title":"Self-supervised image- to-point distillation via semantically tolerant contrastive loss","venue":null,"work_id":"8bba6211-07ec-4603-b339-9fa67c45e679","year":2023},"citing_paper":{"arxiv_id":"2507.17661","last_updated":"2025-07-23T16:29:45Z","snapshot_observed_at":"2026-08-15T13:33:06.202590Z","submitted_at":"2025-07-23T16:29:45Z","title":"Monocular Semantic Scene Completion via Masked Recurrent Networks","version":1},"reference_index":54,"source":"pdf_text","source_observed_at":"2026-08-06T14:48:19.185983Z"},"links":{"citing_paper":"/paper/2507.17661"},"observation_digest":"sha256:c6531d48117bb84d9b3fdceca989c746bb2eec442080e73c7bbc93cd08123364","observation_id":"b5d987d5-96c5-4b83-8c2c-435be8b9d47d","resolution":{"observed_at":"2026-08-06T14:48:21.035136Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2504.17791","last_updated":"2025-07-16T13:45:17Z","snapshot_observed_at":"2026-08-18T00:11:40.718683Z","submitted_at":"2025-04-24T17:59:59Z","title":"LiDPM: Rethinking Point Diffusion for Lidar Scene Completion","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2504.17791","snapshot_observed_at":"2026-08-06T14:48:19.192447Z","title":"Lidpm: Rethinking point diffusion for lidar scene completion","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2507.17661","last_updated":"2025-07-23T16:29:45Z","snapshot_observed_at":"2026-08-15T13:33:06.202590Z","submitted_at":"2025-07-23T16:29:45Z","title":"Monocular Semantic Scene Completion via Masked Recurrent Networks","version":1},"reference_index":55,"source":"pdf_text","source_observed_at":"2026-08-06T14:48:19.192447Z"},"links":{"cited_paper":"/paper/2504.17791","citing_paper":"/paper/2507.17661"},"observation_digest":"sha256:aeebc8ee12b4cd95e4631fda920e6c4b44bf0924053bca7dfbcd4cba852977c3","observation_id":"83212143-e7f4-436e-ac00-e405a2d376d0","resolution":{"observed_at":"2026-08-06T14:48:19.192447Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T14:48:21.008392Z","title":"Occupancy networks: Learning 3d reconstruction in function space","venue":null,"work_id":"c40e77dd-9ca0-43f7-92b4-75ff9ff6bb3f","year":2019},"citing_paper":{"arxiv_id":"2507.17661","last_updated":"2025-07-23T16:29:45Z","snapshot_observed_at":"2026-08-15T13:33:06.202590Z","submitted_at":"2025-07-23T16:29:45Z","title":"Monocular Semantic Scene Completion via Masked Recurrent Networks","version":1},"reference_index":56,"source":"pdf_text","source_observed_at":"2026-08-06T14:48:19.198311Z"},"links":{"citing_paper":"/paper/2507.17661"},"observation_digest":"sha256:9d581c42cbe75a33830f50108b274c4283f7cf2628efea1ac5a665bce157ff50","observation_id":"644f06ab-c4ff-4eec-9641-7c4e13beffe0","resolution":{"observed_at":"2026-08-06T14:48:21.015765Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T14:48:20.988438Z","title":"Train till you drop: Towards stable and robust source-free unsupervised 3d do- main adaptation","venue":null,"work_id":"080507aa-e6c2-4d4d-bcda-b5b40c84ca73","year":2024},"citing_paper":{"arxiv_id":"2507.17661","last_updated":"2025-07-23T16:29:45Z","snapshot_observed_at":"2026-08-15T13:33:06.202590Z","submitted_at":"2025-07-23T16:29:45Z","title":"Monocular Semantic Scene Completion via Masked Recurrent Networks","version":1},"reference_index":57,"source":"pdf_text","source_observed_at":"2026-08-06T14:48:19.205229Z"},"links":{"citing_paper":"/paper/2507.17661"},"observation_digest":"sha256:be5d4e0a3bf068ac3e3edeec8ef9700db3bd3dbe7a209f67d7ebcb77053c64fa","observation_id":"07a804c5-e118-4dcc-8f35-a9e90e8e650b","resolution":{"observed_at":"2026-08-06T14:48:20.995407Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T14:48:20.970814Z","title":"Tempo- ral consistent 3d lidar representation learning for semantic perception in autonomous driving","venue":null,"work_id":"eca7c27f-87fc-42c8-b344-7732ec9a733d","year":2023},"citing_paper":{"arxiv_id":"2507.17661","last_updated":"2025-07-23T16:29:45Z","snapshot_observed_at":"2026-08-15T13:33:06.202590Z","submitted_at":"2025-07-23T16:29:45Z","title":"Monocular Semantic Scene Completion via Masked Recurrent Networks","version":1},"reference_index":58,"source":"pdf_text","source_observed_at":"2026-08-06T14:48:19.211377Z"},"links":{"citing_paper":"/paper/2507.17661"},"observation_digest":"sha256:a42c8ede956ddf1f24122f371f8cab8f80c26b20f5d81dd2eba29634050697a0","observation_id":"85896637-3b88-47a5-95c5-96839c21edd9","resolution":{"observed_at":"2026-08-06T14:48:20.976184Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T14:48:20.939834Z","title":"Deepsdf: Learning con- tinuous signed distance functions for shape representation","venue":null,"work_id":"b11336f0-7203-4bdb-b093-860121411b08","year":2019},"citing_paper":{"arxiv_id":"2507.17661","last_updated":"2025-07-23T16:29:45Z","snapshot_observed_at":"2026-08-15T13:33:06.202590Z","submitted_at":"2025-07-23T16:29:45Z","title":"Monocular Semantic Scene Completion via Masked Recurrent Networks","version":1},"reference_index":59,"source":"pdf_text","source_observed_at":"2026-08-06T14:48:19.216657Z"},"links":{"citing_paper":"/paper/2507.17661"},"observation_digest":"sha256:2f5191b587a5a2ec6e836f58f6a3fb45a6f7cd2c4fbbe8903b3591feb22d53c0","observation_id":"64979861-db0d-4471-92e0-80a21500d5c1","resolution":{"observed_at":"2026-08-06T14:48:20.948206Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T14:48:20.917470Z","title":"Convolutional occupancy networks","venue":null,"work_id":"38248a26-5734-40f0-837a-7429dd770f20","year":2020},"citing_paper":{"arxiv_id":"2507.17661","last_updated":"2025-07-23T16:29:45Z","snapshot_observed_at":"2026-08-15T13:33:06.202590Z","submitted_at":"2025-07-23T16:29:45Z","title":"Monocular Semantic Scene Completion via Masked Recurrent Networks","version":1},"reference_index":60,"source":"pdf_text","source_observed_at":"2026-08-06T14:48:19.221929Z"},"links":{"citing_paper":"/paper/2507.17661"},"observation_digest":"sha256:0fb0ac0b39dbfb0082cdb2f0703ed1674bc4436a99ac55488708fb9558ae3fed","observation_id":"50e67148-6d86-4427-8ca8-793daf5d4d5b","resolution":{"observed_at":"2026-08-06T14:48:20.923906Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T14:48:20.896307Z","title":"Learning to adapt sam for segmenting cross-domain point clouds","venue":null,"work_id":"fe16028a-9196-4af4-b2fc-128598f7ba27","year":2024},"citing_paper":{"arxiv_id":"2507.17661","last_updated":"2025-07-23T16:29:45Z","snapshot_observed_at":"2026-08-15T13:33:06.202590Z","submitted_at":"2025-07-23T16:29:45Z","title":"Monocular Semantic Scene Completion via Masked Recurrent Networks","version":1},"reference_index":61,"source":"pdf_text","source_observed_at":"2026-08-06T14:48:19.226359Z"},"links":{"citing_paper":"/paper/2507.17661"},"observation_digest":"sha256:150828880e88deb6aade40e94510fd8a7970403a94f8163b6285b86ec97bd39d","observation_id":"25070796-d2f1-4981-8123-27579617ac65","resolution":{"observed_at":"2026-08-06T14:48:20.902685Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T14:48:20.867468Z","title":"Using a waffle iron for automotive point cloud semantic segmenta- tion","venue":null,"work_id":"0f37ac05-72ae-491a-a520-b1634c09de8f","year":2023},"citing_paper":{"arxiv_id":"2507.17661","last_updated":"2025-07-23T16:29:45Z","snapshot_observed_at":"2026-08-15T13:33:06.202590Z","submitted_at":"2025-07-23T16:29:45Z","title":"Monocular Semantic Scene Completion via Masked Recurrent Networks","version":1},"reference_index":62,"source":"pdf_text","source_observed_at":"2026-08-06T14:48:19.230315Z"},"links":{"citing_paper":"/paper/2507.17661"},"observation_digest":"sha256:cf5bf59cbc003f0b1c568cc0696e25c03df3d2d7dbbda4dc6b3269cb738772d2","observation_id":"fdf3b5d4-df3f-408f-833c-6da5eb5b6913","resolution":{"observed_at":"2026-08-06T14:48:20.874869Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T14:48:20.845089Z","title":"Three pillars improving vision foundation model distillation for lidar","venue":null,"work_id":"9c271351-d482-4fa2-84ff-43ab670348f3","year":2024},"citing_paper":{"arxiv_id":"2507.17661","last_updated":"2025-07-23T16:29:45Z","snapshot_observed_at":"2026-08-15T13:33:06.202590Z","submitted_at":"2025-07-23T16:29:45Z","title":"Monocular Semantic Scene Completion via Masked Recurrent Networks","version":1},"reference_index":63,"source":"pdf_text","source_observed_at":"2026-08-06T14:48:19.234767Z"},"links":{"citing_paper":"/paper/2507.17661"},"observation_digest":"sha256:83cc2ae4c04b5a886254081adf4a4ca14ab5cad95976256a51338f2dc777c1e5","observation_id":"bfd562af-6518-4cf7-9a55-1859eae1b728","resolution":{"observed_at":"2026-08-06T14:48:20.853688Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T14:48:20.817566Z","title":"Completing 3d object shape from one depth image","venue":null,"work_id":"3d2d4c4a-33f8-47fb-b1c5-51f0018cdaff","year":2015},"citing_paper":{"arxiv_id":"2507.17661","last_updated":"2025-07-23T16:29:45Z","snapshot_observed_at":"2026-08-15T13:33:06.202590Z","submitted_at":"2025-07-23T16:29:45Z","title":"Monocular Semantic Scene Completion via Masked Recurrent Networks","version":1},"reference_index":64,"source":"pdf_text","source_observed_at":"2026-08-06T14:48:19.242845Z"},"links":{"citing_paper":"/paper/2507.17661"},"observation_digest":"sha256:adb3aa2b3ef9f588bff24c0ad87e31ceec8e0d8f5117df468ac3c201700ef882","observation_id":"7b475e4d-5b7d-4e9a-b6be-aa7c3d549df6","resolution":{"observed_at":"2026-08-06T14:48:20.822388Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T14:48:20.798331Z","title":"Lmscnet: Lightweight multiscale 3d se- mantic completion","venue":null,"work_id":"cbe7ed70-da6f-494b-9aa4-48b776f96081","year":2020},"citing_paper":{"arxiv_id":"2507.17661","last_updated":"2025-07-23T16:29:45Z","snapshot_observed_at":"2026-08-15T13:33:06.202590Z","submitted_at":"2025-07-23T16:29:45Z","title":"Monocular Semantic Scene Completion via Masked Recurrent Networks","version":1},"reference_index":65,"source":"pdf_text","source_observed_at":"2026-08-06T14:48:19.248937Z"},"links":{"citing_paper":"/paper/2507.17661"},"observation_digest":"sha256:00f37160d11c71c42137c6b42f10d86f5a04099c354dec1fcaa314052afcef03","observation_id":"26823350-9d9f-4d52-80f2-d8a531565646","resolution":{"observed_at":"2026-08-06T14:48:20.803793Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T14:48:20.753180Z","title":"You never get a second chance to make a good first impression: Seeding ac- tive learning for 3d semantic segmentation","venue":null,"work_id":"14878d0f-50a4-4c70-bc62-a95f446047f6","year":2023},"citing_paper":{"arxiv_id":"2507.17661","last_updated":"2025-07-23T16:29:45Z","snapshot_observed_at":"2026-08-15T13:33:06.202590Z","submitted_at":"2025-07-23T16:29:45Z","title":"Monocular Semantic Scene Completion via Masked Recurrent Networks","version":1},"reference_index":66,"source":"pdf_text","source_observed_at":"2026-08-06T14:48:19.254094Z"},"links":{"citing_paper":"/paper/2507.17661"},"observation_digest":"sha256:92228ea4b67bce202e8dc57b1ac79a1ea3ac41c402e4687cfe234f4261cf4f2c","observation_id":"be3dcbb0-c447-4522-8ee2-5af72770f68e","resolution":{"observed_at":"2026-08-06T14:48:20.767542Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2407.15797","last_updated":"2024-07-22T16:59:49Z","snapshot_observed_at":"2026-08-16T13:32:04.040676Z","submitted_at":"2024-07-22T16:59:49Z","title":"MILAN: Milli-Annotations for Lidar Semantic Segmentation","version":1},"cited_work":{"arxiv_id":"2407.15797","doi":null,"metadata_source":"pith","pith_arxiv_id":"2407.15797","snapshot_observed_at":"2026-08-06T14:48:19.710122Z","title":"MILAN: Milli-Annotations for Lidar Semantic Segmentation","venue":"cs.CV","work_id":"6204e6fb-982b-45ee-8e5a-9022f0a3b1dc","year":2024},"citing_paper":{"arxiv_id":"2507.17661","last_updated":"2025-07-23T16:29:45Z","snapshot_observed_at":"2026-08-15T13:33:06.202590Z","submitted_at":"2025-07-23T16:29:45Z","title":"Monocular Semantic Scene Completion via Masked Recurrent Networks","version":1},"reference_index":67,"source":"pdf_text","source_observed_at":"2026-08-06T14:48:19.258450Z"},"links":{"cited_paper":"/paper/2407.15797","citing_paper":"/paper/2507.17661"},"observation_digest":"sha256:8679388d5f35fd1bb3e15cec3c2466c887557e33174f8df2cb95fa96a2eee5c6","observation_id":"72359adc-1747-4998-8c40-ec07266ca642","resolution":{"observed_at":"2026-08-06T14:48:19.716852Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T14:48:20.725299Z","title":"Image-to-lidar self-supervised distillation for autonomous driving data","venue":null,"work_id":"8e41a523-7e27-4ffe-ac10-6b34d03150bf","year":2022},"citing_paper":{"arxiv_id":"2507.17661","last_updated":"2025-07-23T16:29:45Z","snapshot_observed_at":"2026-08-15T13:33:06.202590Z","submitted_at":"2025-07-23T16:29:45Z","title":"Monocular Semantic Scene Completion via Masked Recurrent Networks","version":1},"reference_index":68,"source":"pdf_text","source_observed_at":"2026-08-06T14:48:19.263547Z"},"links":{"citing_paper":"/paper/2507.17661"},"observation_digest":"sha256:662c16c3e4579f4d5e67333d9b9f1f4e70f4beffb4e86ae8175c9393892787a5","observation_id":"bcf17259-f762-4d7e-99fa-026802ff431d","resolution":{"observed_at":"2026-08-06T14:48:20.733594Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T14:48:20.692726Z","title":"Bevcontrast: Self-supervision in bev space for automotive lidar point clouds","venue":null,"work_id":"a86e352b-2f35-4e27-90af-df90f26d2da5","year":2024},"citing_paper":{"arxiv_id":"2507.17661","last_updated":"2025-07-23T16:29:45Z","snapshot_observed_at":"2026-08-15T13:33:06.202590Z","submitted_at":"2025-07-23T16:29:45Z","title":"Monocular Semantic Scene Completion via Masked Recurrent Networks","version":1},"reference_index":69,"source":"pdf_text","source_observed_at":"2026-08-06T14:48:19.267837Z"},"links":{"citing_paper":"/paper/2507.17661"},"observation_digest":"sha256:12f0e210cd550fc927da44c923b45bb5e30c25bcc3107a11f5d80da025a58851","observation_id":"c8eae49d-f06a-4a88-b6d5-6ef09e34a3cb","resolution":{"observed_at":"2026-08-06T14:48:20.699848Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"2503.13203","doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T14:48:19.672871Z","title":"Clustering is back: Reaching state-of-the-art lidar instance segmentation without training","venue":null,"work_id":"0f37d33d-117e-42ed-835b-431b58a33329","year":2025},"citing_paper":{"arxiv_id":"2507.17661","last_updated":"2025-07-23T16:29:45Z","snapshot_observed_at":"2026-08-15T13:33:06.202590Z","submitted_at":"2025-07-23T16:29:45Z","title":"Monocular Semantic Scene Completion via Masked Recurrent Networks","version":1},"reference_index":70,"source":"pdf_text","source_observed_at":"2026-08-06T14:48:19.272278Z"},"links":{"citing_paper":"/paper/2507.17661"},"observation_digest":"sha256:f11fb91adea55fd579c9a5c102efe69047323f6b998dbb7a90c968f53ea9066f","observation_id":"c7d2f91c-4843-4194-b72a-5f584c023ff4","resolution":{"observed_at":"2026-08-06T14:48:19.684419Z","resolver_source":"raw_fallback","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T14:48:20.671231Z","title":"Indoor segmentation and support inference from rgbd images","venue":null,"work_id":"c12820b0-a0c1-45fd-a09e-b85f8a739da4","year":2012},"citing_paper":{"arxiv_id":"2507.17661","last_updated":"2025-07-23T16:29:45Z","snapshot_observed_at":"2026-08-15T13:33:06.202590Z","submitted_at":"2025-07-23T16:29:45Z","title":"Monocular Semantic Scene Completion via Masked Recurrent Networks","version":1},"reference_index":71,"source":"pdf_text","source_observed_at":"2026-08-06T14:48:19.276992Z"},"links":{"citing_paper":"/paper/2507.17661"},"observation_digest":"sha256:8745fee0f6fc2dc489f8a1d80007734de35b9e19b07ca078c812dded87be6478","observation_id":"c5f576db-4f2d-4378-b2a9-47e688ec787e","resolution":{"observed_at":"2026-08-06T14:48:20.678067Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T14:48:20.646370Z","title":"Chang, Manolis Savva, and Thomas Funkhouser","venue":null,"work_id":"c3aaba30-9385-42f2-8830-9c3a3eacb51a","year":2017},"citing_paper":{"arxiv_id":"2507.17661","last_updated":"2025-07-23T16:29:45Z","snapshot_observed_at":"2026-08-15T13:33:06.202590Z","submitted_at":"2025-07-23T16:29:45Z","title":"Monocular Semantic Scene Completion via Masked Recurrent Networks","version":1},"reference_index":72,"source":"pdf_text","source_observed_at":"2026-08-06T14:48:19.284063Z"},"links":{"citing_paper":"/paper/2507.17661"},"observation_digest":"sha256:38c7d0d3417b5212b651dc2ef0186ba94c1f01596ac98496799bdc0effa98bd7","observation_id":"87c52b9c-6b80-4816-b246-9c3145d7658e","resolution":{"observed_at":"2026-08-06T14:48:20.652748Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T14:48:20.620407Z","title":"Searching efficient 3d archi- tectures with sparse point-voxel convolution","venue":null,"work_id":"bc1660b2-7054-4621-ac5e-8a3e46441809","year":2020},"citing_paper":{"arxiv_id":"2507.17661","last_updated":"2025-07-23T16:29:45Z","snapshot_observed_at":"2026-08-15T13:33:06.202590Z","submitted_at":"2025-07-23T16:29:45Z","title":"Monocular Semantic Scene Completion via Masked Recurrent Networks","version":1},"reference_index":73,"source":"pdf_text","source_observed_at":"2026-08-06T14:48:19.291549Z"},"links":{"citing_paper":"/paper/2507.17661"},"observation_digest":"sha256:acbe20df03f48a612e1c07cbd099a08c46bb39ddc005cd33c862a0ed22266022","observation_id":"d3e42746-52e1-40f1-b7fc-ef249fbfb8dd","resolution":{"observed_at":"2026-08-06T14:48:20.626933Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T14:48:20.552851Z","title":"Semantic scene completion via integrating instances and scene in-the-loop","venue":null,"work_id":"e6b57fa7-c04e-41f2-9390-43731b4ac051","year":2021},"citing_paper":{"arxiv_id":"2507.17661","last_updated":"2025-07-23T16:29:45Z","snapshot_observed_at":"2026-08-15T13:33:06.202590Z","submitted_at":"2025-07-23T16:29:45Z","title":"Monocular Semantic Scene Completion via Masked Recurrent Networks","version":1},"reference_index":74,"source":"pdf_text","source_observed_at":"2026-08-06T14:48:19.299327Z"},"links":{"citing_paper":"/paper/2507.17661"},"observation_digest":"sha256:50c915274bcae96fba18f1d5f3e6fc9a0734f3313dc4d63396156204ec7b4533","observation_id":"114c0670-4bfe-4f36-abb8-d4da5d101e27","resolution":{"observed_at":"2026-08-06T14:48:20.597249Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T14:48:20.503738Z","title":"Meta- rangeseg: Lidar sequence semantic segmentation using mul- tiple feature aggregation","venue":null,"work_id":"79191aa6-0e86-4df0-93c7-d583c9995845","year":2022},"citing_paper":{"arxiv_id":"2507.17661","last_updated":"2025-07-23T16:29:45Z","snapshot_observed_at":"2026-08-15T13:33:06.202590Z","submitted_at":"2025-07-23T16:29:45Z","title":"Monocular Semantic Scene Completion via Masked Recurrent Networks","version":1},"reference_index":75,"source":"pdf_text","source_observed_at":"2026-08-06T14:48:19.304727Z"},"links":{"citing_paper":"/paper/2507.17661"},"observation_digest":"sha256:4625e529f7dfe0a8f5074815b6e9ba7e7e956a408cf3df4b4ec7cdecab21b69b","observation_id":"0109fb70-9406-47ef-aaa2-374768a1e035","resolution":{"observed_at":"2026-08-06T14:48:20.520209Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T14:48:20.482068Z","title":"Lidar2map: In defense of lidar-based semantic map construction using online camera distillation","venue":null,"work_id":"a18b829b-09b9-4aae-8599-94f1f64f11fd","year":2023},"citing_paper":{"arxiv_id":"2507.17661","last_updated":"2025-07-23T16:29:45Z","snapshot_observed_at":"2026-08-15T13:33:06.202590Z","submitted_at":"2025-07-23T16:29:45Z","title":"Monocular Semantic Scene Completion via Masked Recurrent Networks","version":1},"reference_index":76,"source":"pdf_text","source_observed_at":"2026-08-06T14:48:19.309404Z"},"links":{"citing_paper":"/paper/2507.17661"},"observation_digest":"sha256:932acdea04ee451d0c58dcc297eb9d7b50be85b36d3f5297732cf469138a5c8d","observation_id":"d07f0528-0f48-4691-8c60-61ac78934649","resolution":{"observed_at":"2026-08-06T14:48:20.486492Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T14:48:20.462239Z","title":"Not all voxels are equal: Hardness-aware semantic scene completion with self- distillation","venue":null,"work_id":"3aaeb0ae-cc41-4552-901d-480050ebda5e","year":2024},"citing_paper":{"arxiv_id":"2507.17661","last_updated":"2025-07-23T16:29:45Z","snapshot_observed_at":"2026-08-15T13:33:06.202590Z","submitted_at":"2025-07-23T16:29:45Z","title":"Monocular Semantic Scene Completion via Masked Recurrent Networks","version":1},"reference_index":77,"source":"pdf_text","source_observed_at":"2026-08-06T14:48:19.313669Z"},"links":{"citing_paper":"/paper/2507.17661"},"observation_digest":"sha256:27ff6e6a795034d94bcf8b5d23becdf55c2c1b5935c27e9eaefe4021f2de2f80","observation_id":"eb785623-7923-4d15-b271-bfbbc406607e","resolution":{"observed_at":"2026-08-06T14:48:20.470184Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2409.18026","last_updated":"2024-09-26T16:33:16Z","snapshot_observed_at":"2026-08-18T03:55:06.661650Z","submitted_at":"2024-09-26T16:33:16Z","title":"ReliOcc: Towards Reliable Semantic Occupancy Prediction via Uncertainty Learning","version":1},"cited_work":{"arxiv_id":"2409.18026","doi":null,"metadata_source":"pith","pith_arxiv_id":"2409.18026","snapshot_observed_at":"2026-08-06T14:48:19.499026Z","title":"ReliOcc: Towards Reliable Semantic Occupancy Prediction via Uncertainty Learning","venue":"cs.CV","work_id":"3e73a609-c08b-4f55-bfbe-29ddcfd092c3","year":2024},"citing_paper":{"arxiv_id":"2507.17661","last_updated":"2025-07-23T16:29:45Z","snapshot_observed_at":"2026-08-15T13:33:06.202590Z","submitted_at":"2025-07-23T16:29:45Z","title":"Monocular Semantic Scene Completion via Masked Recurrent Networks","version":1},"reference_index":78,"source":"pdf_text","source_observed_at":"2026-08-06T14:48:19.318184Z"},"links":{"cited_paper":"/paper/2409.18026","citing_paper":"/paper/2507.17661"},"observation_digest":"sha256:fa450e0571795527cf0d2bd96692f24f7c7c15851edb326db0aa31eb19f0a97d","observation_id":"8159cfa2-9b09-4bf9-b79f-92583870b381","resolution":{"observed_at":"2026-08-06T14:48:19.509185Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T14:48:20.436536Z","title":"Pointlora: Low-rank adaptation with to- ken selection for point cloud learning","venue":null,"work_id":"6d4de955-90a9-4c26-ab5e-e1a206ad2196","year":2025},"citing_paper":{"arxiv_id":"2507.17661","last_updated":"2025-07-23T16:29:45Z","snapshot_observed_at":"2026-08-15T13:33:06.202590Z","submitted_at":"2025-07-23T16:29:45Z","title":"Monocular Semantic Scene Completion via Masked Recurrent Networks","version":1},"reference_index":79,"source":"pdf_text","source_observed_at":"2026-08-06T14:48:19.322955Z"},"links":{"citing_paper":"/paper/2507.17661"},"observation_digest":"sha256:2ad64ea4c3e024f74a2423fa8f14d970315ab00b443bddf40dd4290a1430269f","observation_id":"1e6a1439-0f40-495b-8a84-024d8857be14","resolution":{"observed_at":"2026-08-06T14:48:20.442320Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T14:48:20.417281Z","title":"Ffnet: Frequency fu- sion network for semantic scene completion","venue":null,"work_id":"719ca83e-3e13-42dd-977f-bd8576c343fc","year":2022},"citing_paper":{"arxiv_id":"2507.17661","last_updated":"2025-07-23T16:29:45Z","snapshot_observed_at":"2026-08-15T13:33:06.202590Z","submitted_at":"2025-07-23T16:29:45Z","title":"Monocular Semantic Scene Completion via Masked Recurrent Networks","version":1},"reference_index":80,"source":"pdf_text","source_observed_at":"2026-08-06T14:48:19.327492Z"},"links":{"citing_paper":"/paper/2507.17661"},"observation_digest":"sha256:82d9bf4bbffc2707cba3d7c91a308918901d19d86241e77b5d55816fa58c7378","observation_id":"f7ba693d-25f8-45ef-b9e8-9e544f9be67b","resolution":{"observed_at":"2026-08-06T14:48:20.424348Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T14:48:20.392888Z","title":"Nuc-net: Non-uniform cylindrical partition network for ef- ficient lidar semantic segmentation","venue":null,"work_id":"2662f974-a1a2-403e-80dd-798e32ba3265","year":2025},"citing_paper":{"arxiv_id":"2507.17661","last_updated":"2025-07-23T16:29:45Z","snapshot_observed_at":"2026-08-15T13:33:06.202590Z","submitted_at":"2025-07-23T16:29:45Z","title":"Monocular Semantic Scene Completion via Masked Recurrent Networks","version":1},"reference_index":81,"source":"pdf_text","source_observed_at":"2026-08-06T14:48:19.332483Z"},"links":{"citing_paper":"/paper/2507.17661"},"observation_digest":"sha256:d91c9e3c89525e062430bb120dccbfc2eb0d08a5ace1d9fd2576c04372c3de42","observation_id":"19e54788-c4d2-4e79-b2bf-c1d50436950d","resolution":{"observed_at":"2026-08-06T14:48:20.399460Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T14:48:20.363524Z","title":"H2gformer: Horizontal-to-global voxel transformer for 3d semantic scene completion","venue":null,"work_id":"d2987bb6-ed3d-4d83-8e9c-ceaec7020efc","year":2024},"citing_paper":{"arxiv_id":"2507.17661","last_updated":"2025-07-23T16:29:45Z","snapshot_observed_at":"2026-08-15T13:33:06.202590Z","submitted_at":"2025-07-23T16:29:45Z","title":"Monocular Semantic Scene Completion via Masked Recurrent Networks","version":1},"reference_index":82,"source":"pdf_text","source_observed_at":"2026-08-06T14:48:19.336862Z"},"links":{"citing_paper":"/paper/2507.17661"},"observation_digest":"sha256:e79b744b30df0ebb1f507caeabc432bfdcaf7f3e4d9067827177bb7cf7b2dabb","observation_id":"3baad1df-a21e-4be6-88fc-67acc4a52a25","resolution":{"observed_at":"2026-08-06T14:48:20.379264Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T14:48:20.336673Z","title":"Scpnet: Se- mantic scene completion on point cloud","venue":null,"work_id":"7ec492b5-9c66-43cf-9ed6-7176d59c9b0a","year":2023},"citing_paper":{"arxiv_id":"2507.17661","last_updated":"2025-07-23T16:29:45Z","snapshot_observed_at":"2026-08-15T13:33:06.202590Z","submitted_at":"2025-07-23T16:29:45Z","title":"Monocular Semantic Scene Completion via Masked Recurrent Networks","version":1},"reference_index":83,"source":"pdf_text","source_observed_at":"2026-08-06T14:48:19.342829Z"},"links":{"citing_paper":"/paper/2507.17661"},"observation_digest":"sha256:6ebae02555c885f75f54388ba44f8d959473ff8976117c30ca5af8d523bd32c0","observation_id":"d047f036-fe1a-49de-b1be-4e073071369f","resolution":{"observed_at":"2026-08-06T14:48:20.347226Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2501.04003","last_updated":"2025-01-07T18:59:55Z","snapshot_observed_at":"2026-08-19T22:12:05.860631Z","submitted_at":"2025-01-07T18:59:55Z","title":"Are VLMs Ready for Autonomous Driving? An Empirical Study from the Reliability, Data, and Metric Perspectives","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2501.04003","snapshot_observed_at":"2026-08-06T14:48:19.348528Z","title":"Are vlms ready for autonomous driving? an empiri- cal study from the reliability, data, and metric perspectives","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2507.17661","last_updated":"2025-07-23T16:29:45Z","snapshot_observed_at":"2026-08-15T13:33:06.202590Z","submitted_at":"2025-07-23T16:29:45Z","title":"Monocular Semantic Scene Completion via Masked Recurrent Networks","version":1},"reference_index":84,"source":"pdf_text","source_observed_at":"2026-08-06T14:48:19.348528Z"},"links":{"cited_paper":"/paper/2501.04003","citing_paper":"/paper/2507.17661"},"observation_digest":"sha256:18c7080a60340091a603ea7041c79e340fb8719b2a804a1094dfc364752e6163","observation_id":"3d08c49b-b6a6-4b7a-b594-9b0289d2b4c6","resolution":{"observed_at":"2026-08-06T14:48:19.348528Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T14:48:20.310485Z","title":"Benchmarking and im- proving bird’s eye view perception robustness in autonomous driving","venue":null,"work_id":"5263aba8-ed6f-4ed2-956f-d2f4b4a60417","year":2025},"citing_paper":{"arxiv_id":"2507.17661","last_updated":"2025-07-23T16:29:45Z","snapshot_observed_at":"2026-08-15T13:33:06.202590Z","submitted_at":"2025-07-23T16:29:45Z","title":"Monocular Semantic Scene Completion via Masked Recurrent Networks","version":1},"reference_index":85,"source":"pdf_text","source_observed_at":"2026-08-06T14:48:19.353138Z"},"links":{"citing_paper":"/paper/2507.17661"},"observation_digest":"sha256:39c52acacc5176fe731046d3a044e27ce76056b9785d795dc0d6d683aa7278ab","observation_id":"1bf1c88d-43d5-4547-8003-79c651f24c48","resolution":{"observed_at":"2026-08-06T14:48:20.324028Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T14:48:20.289069Z","title":"4d contrastive superflows are dense 3d representation learners","venue":null,"work_id":"8913b95d-a5a4-422f-8699-599e8dcc0f43","year":2024},"citing_paper":{"arxiv_id":"2507.17661","last_updated":"2025-07-23T16:29:45Z","snapshot_observed_at":"2026-08-15T13:33:06.202590Z","submitted_at":"2025-07-23T16:29:45Z","title":"Monocular Semantic Scene Completion via Masked Recurrent Networks","version":1},"reference_index":86,"source":"pdf_text","source_observed_at":"2026-08-06T14:48:19.357583Z"},"links":{"citing_paper":"/paper/2507.17661"},"observation_digest":"sha256:411b55c1cd0228b96a1156cfe7d36ad9b48cf740e252342e9fe5061de07aebb5","observation_id":"684de91d-5b50-44bb-aaa9-640495817376","resolution":{"observed_at":"2026-08-06T14:48:20.296154Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T14:48:20.252499Z","title":"Frnet: Frustum-range networks for scalable lidar segmen- tation","venue":null,"work_id":"9a4a8461-ab34-4227-bcb2-b784ae473fc6","year":2025},"citing_paper":{"arxiv_id":"2507.17661","last_updated":"2025-07-23T16:29:45Z","snapshot_observed_at":"2026-08-15T13:33:06.202590Z","submitted_at":"2025-07-23T16:29:45Z","title":"Monocular Semantic Scene Completion via Masked Recurrent Networks","version":1},"reference_index":87,"source":"pdf_text","source_observed_at":"2026-08-06T14:48:19.362435Z"},"links":{"citing_paper":"/paper/2507.17661"},"observation_digest":"sha256:50d8d46a3fd4ef5e39bed6fb9f89e802e1e5e387372f1ae1d0dd506e0b4a07c6","observation_id":"dd5c0652-01ec-4001-a886-65353ac29641","resolution":{"observed_at":"2026-08-06T14:48:20.265162Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T14:48:20.219458Z","title":"Limoe: Mixture of lidar represen- tation learners from automotive scenes","venue":null,"work_id":"1a566611-aae7-4cd1-a4b5-2ae2ff487c7e","year":2025},"citing_paper":{"arxiv_id":"2507.17661","last_updated":"2025-07-23T16:29:45Z","snapshot_observed_at":"2026-08-15T13:33:06.202590Z","submitted_at":"2025-07-23T16:29:45Z","title":"Monocular Semantic Scene Completion via Masked Recurrent Networks","version":1},"reference_index":88,"source":"pdf_text","source_observed_at":"2026-08-06T14:48:19.367938Z"},"links":{"citing_paper":"/paper/2507.17661"},"observation_digest":"sha256:33d3d1fede484dead7a984595129555bc5fe5fab60f289dcb79c1cd36c4cec86","observation_id":"a3dee4f7-c44e-469b-b00e-1fb1c0e795a2","resolution":{"observed_at":"2026-08-06T14:48:20.231202Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T14:48:20.182618Z","title":"Bi-ssc: Geometric-semantic bidirectional fusion for camera-based 3d semantic scene completion","venue":null,"work_id":"7c89d657-8dc9-4877-a436-c13902c3441c","year":2024},"citing_paper":{"arxiv_id":"2507.17661","last_updated":"2025-07-23T16:29:45Z","snapshot_observed_at":"2026-08-15T13:33:06.202590Z","submitted_at":"2025-07-23T16:29:45Z","title":"Monocular Semantic Scene Completion via Masked Recurrent Networks","version":1},"reference_index":89,"source":"pdf_text","source_observed_at":"2026-08-06T14:48:19.372419Z"},"links":{"citing_paper":"/paper/2507.17661"},"observation_digest":"sha256:618083736d82f79caf6922ef6ecb21148678d31988283dcd4e97e6f705f3248a","observation_id":"3bfd38f7-36ce-4547-8f3c-b9b33bbc0ba3","resolution":{"observed_at":"2026-08-06T14:48:20.189367Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T14:48:20.153946Z","title":"Sparse single sweep lidar point cloud segmentation via learning contextual shape priors from scene completion","venue":null,"work_id":"0192bb09-9fbd-4ace-9819-096bc69fc671","year":2021},"citing_paper":{"arxiv_id":"2507.17661","last_updated":"2025-07-23T16:29:45Z","snapshot_observed_at":"2026-08-15T13:33:06.202590Z","submitted_at":"2025-07-23T16:29:45Z","title":"Monocular Semantic Scene Completion via Masked Recurrent Networks","version":1},"reference_index":90,"source":"pdf_text","source_observed_at":"2026-08-06T14:48:19.377488Z"},"links":{"citing_paper":"/paper/2507.17661"},"observation_digest":"sha256:5208a30119a2f220e60aa5f749f912b9158fb93f8647b0f0afda95e20fb6f45d","observation_id":"04286f8d-8311-434c-a6ae-70835e133402","resolution":{"observed_at":"2026-08-06T14:48:20.161878Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T14:48:20.130233Z","title":"2dpass: 2d priors assisted semantic segmentation on lidar point clouds","venue":null,"work_id":"7f5f2581-8481-4662-95b7-70bf288529c6","year":2022},"citing_paper":{"arxiv_id":"2507.17661","last_updated":"2025-07-23T16:29:45Z","snapshot_observed_at":"2026-08-15T13:33:06.202590Z","submitted_at":"2025-07-23T16:29:45Z","title":"Monocular Semantic Scene Completion via Masked Recurrent Networks","version":1},"reference_index":91,"source":"pdf_text","source_observed_at":"2026-08-06T14:48:19.381511Z"},"links":{"citing_paper":"/paper/2507.17661"},"observation_digest":"sha256:dc783b98bda191e3a6252162e950fad6661e2e549df3ed7c0f5a81f269ccfecb","observation_id":"6156eb08-6432-4499-a00d-17a6406cc98a","resolution":{"observed_at":"2026-08-06T14:48:20.136522Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T14:48:20.089005Z","title":"Ndc-scene: Boost monocular 3d semantic scene completion in normalized de- vice coordinates space","venue":null,"work_id":"7ea02e2c-6b8e-446e-a52e-21c6acac75ba","year":2023},"citing_paper":{"arxiv_id":"2507.17661","last_updated":"2025-07-23T16:29:45Z","snapshot_observed_at":"2026-08-15T13:33:06.202590Z","submitted_at":"2025-07-23T16:29:45Z","title":"Monocular Semantic Scene Completion via Masked Recurrent Networks","version":1},"reference_index":92,"source":"pdf_text","source_observed_at":"2026-08-06T14:48:19.389102Z"},"links":{"citing_paper":"/paper/2507.17661"},"observation_digest":"sha256:80e7398681818974f2a02bd93e2ba8126563475700b35a0d582d71abab980b82","observation_id":"97608196-40eb-4d9c-bcf7-a586eb25c03a","resolution":{"observed_at":"2026-08-06T14:48:20.109252Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T14:48:20.066264Z","title":"Efficient semantic scene comple- tion network with spatial group convolution","venue":null,"work_id":"581052ec-09e4-4e99-8291-4c1821f6b648","year":2018},"citing_paper":{"arxiv_id":"2507.17661","last_updated":"2025-07-23T16:29:45Z","snapshot_observed_at":"2026-08-15T13:33:06.202590Z","submitted_at":"2025-07-23T16:29:45Z","title":"Monocular Semantic Scene Completion via Masked Recurrent Networks","version":1},"reference_index":93,"source":"pdf_text","source_observed_at":"2026-08-06T14:48:19.397651Z"},"links":{"citing_paper":"/paper/2507.17661"},"observation_digest":"sha256:22d1b15dee3a8cb5cf26161c6295c794a5137359c26ebcd668f37e06f15eb38f","observation_id":"6950cb2a-f3b4-4333-a99b-4937c3e46944","resolution":{"observed_at":"2026-08-06T14:48:20.075724Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T14:48:20.028424Z","title":"Occformer: Dual-path transformer for vision-based 3d semantic occu- pancy prediction","venue":null,"work_id":"c25e07a4-c0e1-4338-be15-9b1f4e082f78","year":2023},"citing_paper":{"arxiv_id":"2507.17661","last_updated":"2025-07-23T16:29:45Z","snapshot_observed_at":"2026-08-15T13:33:06.202590Z","submitted_at":"2025-07-23T16:29:45Z","title":"Monocular Semantic Scene Completion via Masked Recurrent Networks","version":1},"reference_index":94,"source":"pdf_text","source_observed_at":"2026-08-06T14:48:19.405981Z"},"links":{"citing_paper":"/paper/2507.17661"},"observation_digest":"sha256:c5a6eac5b30c5c02d7b819f32da33bc4456cf78a6505ba2780502c5d09a74d5f","observation_id":"b34976a5-1c1a-4913-ab21-6f0ac57abfe9","resolution":{"observed_at":"2026-08-06T14:48:20.039856Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T14:48:20.000227Z","title":"Monoocc: Digging into monocular semantic oc- cupancy prediction","venue":null,"work_id":"eb3e0d9a-baf0-417d-85e9-ff013d767445","year":2024},"citing_paper":{"arxiv_id":"2507.17661","last_updated":"2025-07-23T16:29:45Z","snapshot_observed_at":"2026-08-15T13:33:06.202590Z","submitted_at":"2025-07-23T16:29:45Z","title":"Monocular Semantic Scene Completion via Masked Recurrent Networks","version":1},"reference_index":95,"source":"pdf_text","source_observed_at":"2026-08-06T14:48:19.411266Z"},"links":{"citing_paper":"/paper/2507.17661"},"observation_digest":"sha256:937609f898fef1a6a3900377f0cf2022492106c7a4cdc95bc3d04767f7bbf418","observation_id":"a6bf403b-d13a-4658-b8ec-21793f6403aa","resolution":{"observed_at":"2026-08-06T14:48:20.012032Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}}],"paper":{"arxiv_id":"2507.17661","last_updated":"2025-07-23T16:29:45Z","latest_version":1,"primary_category":"cs.CV","snapshot_observed_at":"2026-08-15T13:33:06.202590Z","submitted_at":"2025-07-23T16:29:45Z","title":"Monocular Semantic Scene Completion via Masked Recurrent Networks"},"reference_resolution":{"displayed":95,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":20,"verified_exact":5,"verified_fuzzy":70},"total_outbound_references":95},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"thesis":"As of 21 August 2026, this Paper Citation Record lists 95 of 95 outbound references and 0 inbound Pith citation observations for arXiv:2507.17661."}