{"as_of":"2026-08-19T00:09:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:a810d4b4992bfd34f9c1488431b3f8ef9be588f25b520c446be29ef17b32a0a8","coverage":[{"denominator":49,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":49,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-15T18:03:32.139207Z","state":"measured"},{"denominator":49,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":49,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-18T06:34:40.430872+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2507.19188/citation-record","integrity":"/paper/2507.19188/integrity","json":"/paper/2507.19188/citation-record.json","paper":"/paper/2507.19188"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T18:03:31.453830Z","title":"Se- mantickitti: A dataset for semantic scene understanding of lidar sequences","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2507.19188","last_updated":"2025-07-25T11:57:18Z","snapshot_observed_at":"2026-08-18T11:07:02.491563Z","submitted_at":"2025-07-25T11:57:18Z","title":"VisHall3D: Monocular Semantic Scene Completion from Reconstructing the Visible Regions to Hallucinating the Invisible Regions","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-15T18:03:31.453830Z"},"links":{"citing_paper":"/paper/2507.19188"},"observation_digest":"sha256:7e5a8b10934147dc2d11292765cf75d80d7b850af29e168b2f7efa9b7aee5218","observation_id":"3fd24042-94ef-48ba-9644-8f93b7d9b22c","resolution":{"observed_at":"2026-08-15T18:03:31.453830Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T18:03:33.537689Z","title":"Cascade r-cnn: High quality object detection and instance segmentation.IEEE transactions on pattern analysis and machine intelligence, 43(5):1483–1498, 2019","venue":null,"work_id":"4c18fc05-e42b-4a32-8ffa-70e1d6d75fba","year":2019},"citing_paper":{"arxiv_id":"2507.19188","last_updated":"2025-07-25T11:57:18Z","snapshot_observed_at":"2026-08-18T11:07:02.491563Z","submitted_at":"2025-07-25T11:57:18Z","title":"VisHall3D: Monocular Semantic Scene Completion from Reconstructing the Visible Regions to Hallucinating the Invisible Regions","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-15T18:03:31.500896Z"},"links":{"citing_paper":"/paper/2507.19188"},"observation_digest":"sha256:d36cd18044e624210a86618c5ce8f2e6c5648c1df114a0d4a5a79ddbf17f2ae2","observation_id":"5316296d-2071-4a79-a62e-df6640ca9116","resolution":{"observed_at":"2026-08-15T18:03:33.541695Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T18:03:33.524362Z","title":"Monoscene: Monoc- ular 3d semantic scene completion","venue":null,"work_id":"a0e52b07-ff05-4fcb-bdc3-fe83d8cfc3b5","year":2022},"citing_paper":{"arxiv_id":"2507.19188","last_updated":"2025-07-25T11:57:18Z","snapshot_observed_at":"2026-08-18T11:07:02.491563Z","submitted_at":"2025-07-25T11:57:18Z","title":"VisHall3D: Monocular Semantic Scene Completion from Reconstructing the Visible Regions to Hallucinating the Invisible Regions","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-15T18:03:31.539974Z"},"links":{"citing_paper":"/paper/2507.19188"},"observation_digest":"sha256:f8ed6aec037106367e024feaa2cb59082758aeca9d2c0137277f3a2a1bebb9e1","observation_id":"d9371193-a320-44b5-bb61-844344c6ddd3","resolution":{"observed_at":"2026-08-15T18:03:33.528840Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T18:03:31.546518Z","title":"End-to- end object detection with transformers","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2507.19188","last_updated":"2025-07-25T11:57:18Z","snapshot_observed_at":"2026-08-18T11:07:02.491563Z","submitted_at":"2025-07-25T11:57:18Z","title":"VisHall3D: Monocular Semantic Scene Completion from Reconstructing the Visible Regions to Hallucinating the Invisible Regions","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-15T18:03:31.546518Z"},"links":{"citing_paper":"/paper/2507.19188"},"observation_digest":"sha256:0d49f6d35db2445b7a24a6adbaead82c52a902a9e1ef9d9978244ca5cadac408","observation_id":"55482347-e13d-41bb-907d-cc803fe5ef52","resolution":{"observed_at":"2026-08-15T18:03:31.546518Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T18:03:33.503716Z","title":"Epro-pnp: Generalized end-to-end prob- abilistic perspective-n-points for monocular object pose es- timation","venue":null,"work_id":"7096ed0b-1ac2-416c-96c5-49dad95ab01e","year":null},"citing_paper":{"arxiv_id":"2507.19188","last_updated":"2025-07-25T11:57:18Z","snapshot_observed_at":"2026-08-18T11:07:02.491563Z","submitted_at":"2025-07-25T11:57:18Z","title":"VisHall3D: Monocular Semantic Scene Completion from Reconstructing the Visible Regions to Hallucinating the Invisible Regions","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-15T18:03:31.551103Z"},"links":{"citing_paper":"/paper/2507.19188"},"observation_digest":"sha256:6dfd42c0a6fd83f86b3b5e3857b73714a5121951650520a0afdee3d160a35284","observation_id":"dadc0834-7949-4e12-b69a-267821e6dc18","resolution":{"observed_at":"2026-08-15T18:03:33.508720Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T18:03:33.490039Z","title":"S3cnet: A sparse semantic scene completion net- work for lidar point clouds","venue":null,"work_id":"a9f7606e-dae1-40db-8b51-19140602fc87","year":2021},"citing_paper":{"arxiv_id":"2507.19188","last_updated":"2025-07-25T11:57:18Z","snapshot_observed_at":"2026-08-18T11:07:02.491563Z","submitted_at":"2025-07-25T11:57:18Z","title":"VisHall3D: Monocular Semantic Scene Completion from Reconstructing the Visible Regions to Hallucinating the Invisible Regions","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-15T18:03:31.554819Z"},"links":{"citing_paper":"/paper/2507.19188"},"observation_digest":"sha256:f4c8ee3b9d6dfa02c67f924fc3a3b735e297190a54ec8cb0622dcc635c3596c8","observation_id":"088bfbd8-34b0-4b63-93f5-3b777fe962d5","resolution":{"observed_at":"2026-08-15T18:03:33.494607Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T18:03:31.558499Z","title":"Fast r-cnn","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2507.19188","last_updated":"2025-07-25T11:57:18Z","snapshot_observed_at":"2026-08-18T11:07:02.491563Z","submitted_at":"2025-07-25T11:57:18Z","title":"VisHall3D: Monocular Semantic Scene Completion from Reconstructing the Visible Regions to Hallucinating the Invisible Regions","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-15T18:03:31.558499Z"},"links":{"citing_paper":"/paper/2507.19188"},"observation_digest":"sha256:8f194a0fc5b431aa1d187baf5ce12d7db8a75036bb1a81164a73fe0f207a4f39","observation_id":"117c5474-eedd-4263-9d33-884a55133418","resolution":{"observed_at":"2026-08-15T18:03:31.558499Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T18:03:31.562284Z","title":"Deep residual learning for image recognition","venue":null,"work_id":null,"year":2016},"citing_paper":{"arxiv_id":"2507.19188","last_updated":"2025-07-25T11:57:18Z","snapshot_observed_at":"2026-08-18T11:07:02.491563Z","submitted_at":"2025-07-25T11:57:18Z","title":"VisHall3D: Monocular Semantic Scene Completion from Reconstructing the Visible Regions to Hallucinating the Invisible Regions","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-15T18:03:31.562284Z"},"links":{"citing_paper":"/paper/2507.19188"},"observation_digest":"sha256:de6dd0b78c71a78102c21ebd3eb085d0fecb04d5b3fc815b3c68591e7b0807f5","observation_id":"5a354be0-fc69-4b0d-abb0-4454258fb6e7","resolution":{"observed_at":"2026-08-15T18:03:31.562284Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T18:03:31.566214Z","title":"Masked autoencoders are scalable vision learners","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2507.19188","last_updated":"2025-07-25T11:57:18Z","snapshot_observed_at":"2026-08-18T11:07:02.491563Z","submitted_at":"2025-07-25T11:57:18Z","title":"VisHall3D: Monocular Semantic Scene Completion from Reconstructing the Visible Regions to Hallucinating the Invisible Regions","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-15T18:03:31.566214Z"},"links":{"citing_paper":"/paper/2507.19188"},"observation_digest":"sha256:285bf5a456abbca760dae23c7f820d18ea78758046d40842f41a70f9c9434286","observation_id":"d4d7881e-8865-4e50-a5a5-f238bc94e31a","resolution":{"observed_at":"2026-08-15T18:03:31.566214Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T18:03:33.388642Z","title":"Arbitrary style transfer in real-time with adaptive instance normalization","venue":null,"work_id":"1bab9013-1996-4c97-b3bf-7d70a1a1df16","year":2017},"citing_paper":{"arxiv_id":"2507.19188","last_updated":"2025-07-25T11:57:18Z","snapshot_observed_at":"2026-08-18T11:07:02.491563Z","submitted_at":"2025-07-25T11:57:18Z","title":"VisHall3D: Monocular Semantic Scene Completion from Reconstructing the Visible Regions to Hallucinating the Invisible Regions","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-15T18:03:31.569569Z"},"links":{"citing_paper":"/paper/2507.19188"},"observation_digest":"sha256:a41c8a342c585a50137561f02e10cc9cf49ac95aecc4ee7637dc787720da5184","observation_id":"290a6b74-3196-4ef6-84ac-d388c0de4c73","resolution":{"observed_at":"2026-08-15T18:03:33.423058Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T18:03:33.307953Z","title":"Tri-perspective view for vision- based 3d semantic occupancy prediction","venue":null,"work_id":"f885a6a6-1de8-4e5a-b557-478cdb2df1fa","year":2023},"citing_paper":{"arxiv_id":"2507.19188","last_updated":"2025-07-25T11:57:18Z","snapshot_observed_at":"2026-08-18T11:07:02.491563Z","submitted_at":"2025-07-25T11:57:18Z","title":"VisHall3D: Monocular Semantic Scene Completion from Reconstructing the Visible Regions to Hallucinating the Invisible Regions","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-15T18:03:31.572669Z"},"links":{"citing_paper":"/paper/2507.19188"},"observation_digest":"sha256:b125eeab49b449b0e894184b01a30e028a3d9b55b30e46f002bebe507c9d9f42","observation_id":"b9937226-3d54-45d7-9b10-7ff22319d304","resolution":{"observed_at":"2026-08-15T18:03:33.345524Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T18:03:33.245238Z","title":"Sym- phonize 3d semantic scene completion with contextual in- stance queries","venue":null,"work_id":"fa494fb4-b3bd-4af6-83dc-c36b5c3e7e1f","year":2024},"citing_paper":{"arxiv_id":"2507.19188","last_updated":"2025-07-25T11:57:18Z","snapshot_observed_at":"2026-08-18T11:07:02.491563Z","submitted_at":"2025-07-25T11:57:18Z","title":"VisHall3D: Monocular Semantic Scene Completion from Reconstructing the Visible Regions to Hallucinating the Invisible Regions","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-15T18:03:31.575812Z"},"links":{"citing_paper":"/paper/2507.19188"},"observation_digest":"sha256:b2f229b8056f5a0ad8b000398d8d315373eed49aea3d49812e12432cd524482c","observation_id":"6345334e-0094-441a-b6e7-c384ed271140","resolution":{"observed_at":"2026-08-15T18:03:33.248737Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2404.12501","last_updated":"2024-09-03T10:12:34Z","snapshot_observed_at":"2026-08-18T12:31:58.400855Z","submitted_at":"2024-04-18T20:43:33Z","title":"SPIdepth: Strengthened Pose Information for Self-supervised Monocular Depth Estimation","version":3},"cited_work":{"arxiv_id":"2404.12501","doi":null,"metadata_source":"pith","pith_arxiv_id":"2404.12501","snapshot_observed_at":"2026-08-15T18:03:32.261879Z","title":"SPIdepth: Strengthened Pose Information for Self-supervised Monocular Depth Estimation","venue":"cs.CV","work_id":"710820f2-e9c5-44d7-a6fd-a703bbe12f04","year":2024},"citing_paper":{"arxiv_id":"2507.19188","last_updated":"2025-07-25T11:57:18Z","snapshot_observed_at":"2026-08-18T11:07:02.491563Z","submitted_at":"2025-07-25T11:57:18Z","title":"VisHall3D: Monocular Semantic Scene Completion from Reconstructing the Visible Regions to Hallucinating the Invisible Regions","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-15T18:03:31.581096Z"},"links":{"cited_paper":"/paper/2404.12501","citing_paper":"/paper/2507.19188"},"observation_digest":"sha256:371ea2993237e1c73bdcf3b7807b5fca249089c87695ae76ffa3dcc550b7e503","observation_id":"4ce8e6ef-c217-431d-834f-fa4d59d419a9","resolution":{"observed_at":"2026-08-15T18:03:32.268432Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2303.13959","last_updated":"2024-05-06T15:14:22Z","snapshot_observed_at":"2026-08-16T15:45:38.834701Z","submitted_at":"2023-03-24T12:33:44Z","title":"Bridging Stereo Geometry and BEV Representation with Reliable Mutual Interaction for Semantic Scene Completion","version":6},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2303.13959","snapshot_observed_at":"2026-08-15T18:03:31.584891Z","title":"Bridging stereo geometry and bev repre- sentation with reliable mutual interaction for semantic scene completion.arXiv preprint arXiv:2303.13959, 2023","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2507.19188","last_updated":"2025-07-25T11:57:18Z","snapshot_observed_at":"2026-08-18T11:07:02.491563Z","submitted_at":"2025-07-25T11:57:18Z","title":"VisHall3D: Monocular Semantic Scene Completion from Reconstructing the Visible Regions to Hallucinating the Invisible Regions","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-15T18:03:31.584891Z"},"links":{"cited_paper":"/paper/2303.13959","citing_paper":"/paper/2507.19188"},"observation_digest":"sha256:c3666d4b656fa88f99603b38b2d6cb4aa5b29c2f37745f8aa87eaf73bc7c9f3e","observation_id":"2c06876a-3c24-42ed-b03f-68a917754ad5","resolution":{"observed_at":"2026-08-15T18:03:31.584891Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2407.02077","last_updated":"2024-11-06T05:11:24Z","snapshot_observed_at":"2026-08-16T13:37:49.846435Z","submitted_at":"2024-07-02T09:11:17Z","title":"Hierarchical Temporal Context Learning for Camera-based Semantic Scene Completion","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2407.02077","snapshot_observed_at":"2026-08-15T18:03:31.588648Z","title":"Hierarchical temporal context learning for camera-based semantic scene comple- tion.arXiv preprint arXiv:2407.02077, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.19188","last_updated":"2025-07-25T11:57:18Z","snapshot_observed_at":"2026-08-18T11:07:02.491563Z","submitted_at":"2025-07-25T11:57:18Z","title":"VisHall3D: Monocular Semantic Scene Completion from Reconstructing the Visible Regions to Hallucinating the Invisible Regions","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-15T18:03:31.588648Z"},"links":{"cited_paper":"/paper/2407.02077","citing_paper":"/paper/2507.19188"},"observation_digest":"sha256:1e592632d407d5e921ce5e70187e15f3a7a02e6ef99e80a8b653c1ca3bcd5052","observation_id":"45421922-21a0-4b3b-bcf1-7cd49da8c14f","resolution":{"observed_at":"2026-08-15T18:03:31.588648Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T18:03:33.233801Z","title":"Mask dino: Towards a unified transformer-based framework for object detection and segmentation","venue":null,"work_id":"464b771f-9f20-4ec7-b22b-9b4352c24f1a","year":2023},"citing_paper":{"arxiv_id":"2507.19188","last_updated":"2025-07-25T11:57:18Z","snapshot_observed_at":"2026-08-18T11:07:02.491563Z","submitted_at":"2025-07-25T11:57:18Z","title":"VisHall3D: Monocular Semantic Scene Completion from Reconstructing the Visible Regions to Hallucinating the Invisible Regions","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-15T18:03:31.591991Z"},"links":{"citing_paper":"/paper/2507.19188"},"observation_digest":"sha256:1c60de307cbbdeaabcd8df5684684ab91e8c05592757efd25e640b16b24fea67","observation_id":"2f844a04-52e8-4fa4-b180-d88ff6d6f7fb","resolution":{"observed_at":"2026-08-15T18:03:33.237575Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T18:03:33.219919Z","title":"Dfa3d: 3d deformable attention for 2d-to-3d feature lifting","venue":null,"work_id":"f620a973-b2da-4704-97dc-98ab0e9d2211","year":2023},"citing_paper":{"arxiv_id":"2507.19188","last_updated":"2025-07-25T11:57:18Z","snapshot_observed_at":"2026-08-18T11:07:02.491563Z","submitted_at":"2025-07-25T11:57:18Z","title":"VisHall3D: Monocular Semantic Scene Completion from Reconstructing the Visible Regions to Hallucinating the Invisible Regions","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-15T18:03:31.595439Z"},"links":{"citing_paper":"/paper/2507.19188"},"observation_digest":"sha256:dd92b96225cdd76d0f84d721f8a87dae4f5b10aa71a55ca508089723fb7be93a","observation_id":"2fbdf735-8c4d-4dda-8204-1f308535e0b2","resolution":{"observed_at":"2026-08-15T18:03:33.224904Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T18:03:33.207262Z","title":"Depth based semantic scene completion with position importance aware loss.IEEE Robotics and Automation Letters, 5(1):219–226, 2019","venue":null,"work_id":"ba0be8c0-d5f9-4416-bb8f-53a66f85d603","year":2019},"citing_paper":{"arxiv_id":"2507.19188","last_updated":"2025-07-25T11:57:18Z","snapshot_observed_at":"2026-08-18T11:07:02.491563Z","submitted_at":"2025-07-25T11:57:18Z","title":"VisHall3D: Monocular Semantic Scene Completion from Reconstructing the Visible Regions to Hallucinating the Invisible Regions","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-15T18:03:31.598910Z"},"links":{"citing_paper":"/paper/2507.19188"},"observation_digest":"sha256:c537220e2918f3b05c559f752e917bc97035d79aa6096fcf7381d9c12dc9f3f8","observation_id":"63c73258-2446-4fc8-a55f-81708923869c","resolution":{"observed_at":"2026-08-15T18:03:33.211621Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T18:03:33.195902Z","title":"Anisotropic convolutional networks for 3d semantic scene completion","venue":null,"work_id":"ff5ef0e6-1db8-4aaf-a8ca-271e51f2914e","year":2020},"citing_paper":{"arxiv_id":"2507.19188","last_updated":"2025-07-25T11:57:18Z","snapshot_observed_at":"2026-08-18T11:07:02.491563Z","submitted_at":"2025-07-25T11:57:18Z","title":"VisHall3D: Monocular Semantic Scene Completion from Reconstructing the Visible Regions to Hallucinating the Invisible Regions","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-15T18:03:31.602127Z"},"links":{"citing_paper":"/paper/2507.19188"},"observation_digest":"sha256:8cff24f23eff4ce187b87971e06c749583a8b41e5c6c4b0afacb0b067ff6f170","observation_id":"a4720678-437f-4337-9e15-321387fec12b","resolution":{"observed_at":"2026-08-15T18:03:33.199784Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T18:03:33.183817Z","title":"V oxformer: Sparse voxel transformer for camera- based 3d semantic scene completion","venue":null,"work_id":"043ef475-2494-4b1e-a683-fe5b234debda","year":2023},"citing_paper":{"arxiv_id":"2507.19188","last_updated":"2025-07-25T11:57:18Z","snapshot_observed_at":"2026-08-18T11:07:02.491563Z","submitted_at":"2025-07-25T11:57:18Z","title":"VisHall3D: Monocular Semantic Scene Completion from Reconstructing the Visible Regions to Hallucinating the Invisible Regions","version":1},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-15T18:03:31.605409Z"},"links":{"citing_paper":"/paper/2507.19188"},"observation_digest":"sha256:085dbf80878c90e28971724939cd4243fca41fb9c3d67abf7fda820e1c4c9a8a","observation_id":"498edc93-fea1-4919-b21e-98eb6554131f","resolution":{"observed_at":"2026-08-15T18:03:33.188409Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T18:03:33.118996Z","title":"Ss- cbench: A large-scale 3d semantic scene completion bench- mark for autonomous driving","venue":null,"work_id":"6ae77972-527c-4eee-b84f-7496d071e638","year":null},"citing_paper":{"arxiv_id":"2507.19188","last_updated":"2025-07-25T11:57:18Z","snapshot_observed_at":"2026-08-18T11:07:02.491563Z","submitted_at":"2025-07-25T11:57:18Z","title":"VisHall3D: Monocular Semantic Scene Completion from Reconstructing the Visible Regions to Hallucinating the Invisible Regions","version":1},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-15T18:03:31.609037Z"},"links":{"citing_paper":"/paper/2507.19188"},"observation_digest":"sha256:d47c5efe2d29a05e44451de4358c43722ab32a43927faaa040fc7d6d7b83d97c","observation_id":"cc156780-ced0-45eb-87f9-c268855a91c4","resolution":{"observed_at":"2026-08-15T18:03:33.174733Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T18:03:32.903411Z","title":"Bevformer: Learning bird’s-eye-view representation from multi-camera images via spatiotemporal transformers","venue":null,"work_id":"f72f6a4c-0d4e-49c3-94cc-2d2d5977ccc6","year":null},"citing_paper":{"arxiv_id":"2507.19188","last_updated":"2025-07-25T11:57:18Z","snapshot_observed_at":"2026-08-18T11:07:02.491563Z","submitted_at":"2025-07-25T11:57:18Z","title":"VisHall3D: Monocular Semantic Scene Completion from Reconstructing the Visible Regions to Hallucinating the Invisible Regions","version":1},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-15T18:03:31.612519Z"},"links":{"citing_paper":"/paper/2507.19188"},"observation_digest":"sha256:25df67a0c0d6eedfc1d6a7e0ceef0489ca7e5dd4906505829d6efe7b7eecf2d3","observation_id":"d8e210f2-cefa-4c73-875b-007bec49bd41","resolution":{"observed_at":"2026-08-15T18:03:33.007002Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T18:03:32.842396Z","title":"Diversity matters: Fully exploiting depth clues for reliable monocular 3d object detection","venue":null,"work_id":"8a3f7b6f-4df0-4bc8-86a9-d61d2a9d58b8","year":2022},"citing_paper":{"arxiv_id":"2507.19188","last_updated":"2025-07-25T11:57:18Z","snapshot_observed_at":"2026-08-18T11:07:02.491563Z","submitted_at":"2025-07-25T11:57:18Z","title":"VisHall3D: Monocular Semantic Scene Completion from Reconstructing the Visible Regions to Hallucinating the Invisible Regions","version":1},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-15T18:03:31.615989Z"},"links":{"citing_paper":"/paper/2507.19188"},"observation_digest":"sha256:a53c7419291f537dcca8474388b3a1009e74395a5d576cefc8890f8b2b1e3319","observation_id":"fd158001-c122-4c08-9881-e95e4569d4e5","resolution":{"observed_at":"2026-08-15T18:03:32.846568Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2307.01492","last_updated":"2023-07-04T05:55:54Z","snapshot_observed_at":"2026-08-18T08:37:31.401379Z","submitted_at":"2023-07-04T05:55:54Z","title":"FB-OCC: 3D Occupancy Prediction based on Forward-Backward View Transformation","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2307.01492","snapshot_observed_at":"2026-08-15T18:03:31.619484Z","title":"Fb-occ: 3d occupancy prediction based on forward-backward view transformation","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2507.19188","last_updated":"2025-07-25T11:57:18Z","snapshot_observed_at":"2026-08-18T11:07:02.491563Z","submitted_at":"2025-07-25T11:57:18Z","title":"VisHall3D: Monocular Semantic Scene Completion from Reconstructing the Visible Regions to Hallucinating the Invisible Regions","version":1},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-15T18:03:31.619484Z"},"links":{"cited_paper":"/paper/2307.01492","citing_paper":"/paper/2507.19188"},"observation_digest":"sha256:a27742192ae1276ef8c6247fc2716803705aaafebd7497875abd099467bd939e","observation_id":"3a68e6fc-a8cc-4de8-a6a1-7382e9e63375","resolution":{"observed_at":"2026-08-15T18:03:31.619484Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T18:03:32.831704Z","title":"Kitti-360: A novel dataset and benchmarks for urban scene understanding in 2d and 3d.IEEE Transactions on Pattern Analysis and Machine Intelligence, 45(3):3292–3310, 2022","venue":null,"work_id":"82521616-f66a-4f0d-8f93-5f3e221ecc95","year":2022},"citing_paper":{"arxiv_id":"2507.19188","last_updated":"2025-07-25T11:57:18Z","snapshot_observed_at":"2026-08-18T11:07:02.491563Z","submitted_at":"2025-07-25T11:57:18Z","title":"VisHall3D: Monocular Semantic Scene Completion from Reconstructing the Visible Regions to Hallucinating the Invisible Regions","version":1},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-08-15T18:03:31.623380Z"},"links":{"citing_paper":"/paper/2507.19188"},"observation_digest":"sha256:e973a792011a9e818c55b9e4178cf4546f60d645053742baa03c87a84b370b42","observation_id":"8e701c10-cc30-4361-ae56-fc98f44bc44d","resolution":{"observed_at":"2026-08-15T18:03:32.835632Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2402.18140","last_updated":"2024-02-28T08:03:34Z","snapshot_observed_at":"2026-08-16T18:13:29.672838Z","submitted_at":"2024-02-28T08:03:34Z","title":"OccTransformer: Improving BEVFormer for 3D camera-only occupancy prediction","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.18140","snapshot_observed_at":"2026-08-15T18:03:31.682905Z","title":"Occtransformer: Improving bev- former for 3d camera-only occupancy prediction.arXiv preprint arXiv:2402.18140, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.19188","last_updated":"2025-07-25T11:57:18Z","snapshot_observed_at":"2026-08-18T11:07:02.491563Z","submitted_at":"2025-07-25T11:57:18Z","title":"VisHall3D: Monocular Semantic Scene Completion from Reconstructing the Visible Regions to Hallucinating the Invisible Regions","version":1},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-08-15T18:03:31.682905Z"},"links":{"cited_paper":"/paper/2402.18140","citing_paper":"/paper/2507.19188"},"observation_digest":"sha256:8663fd5b41ce9def348b9d5449db6c673b12d2c34cedbd9f05300b1e052dd585","observation_id":"23550225-e687-40c3-8b0b-d23a57a57f65","resolution":{"observed_at":"2026-08-15T18:03:31.682905Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T18:03:32.819463Z","title":"Autoshape: Real-time shape-aware monoc- ular 3d object detection","venue":null,"work_id":"8244aeba-a9ec-4742-8128-93f35fc02879","year":2021},"citing_paper":{"arxiv_id":"2507.19188","last_updated":"2025-07-25T11:57:18Z","snapshot_observed_at":"2026-08-18T11:07:02.491563Z","submitted_at":"2025-07-25T11:57:18Z","title":"VisHall3D: Monocular Semantic Scene Completion from Reconstructing the Visible Regions to Hallucinating the Invisible Regions","version":1},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-08-15T18:03:31.717877Z"},"links":{"citing_paper":"/paper/2507.19188"},"observation_digest":"sha256:6f5807eb7c9e325b45b260ab3e3c93516659263b9cd7439b04b60167deb74541","observation_id":"580cae1b-a202-4945-80a0-a77578edb8c6","resolution":{"observed_at":"2026-08-15T18:03:32.823456Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T18:03:32.807112Z","title":"M3dssd: Monocular 3d single stage object detector","venue":null,"work_id":"6da20312-a700-4362-a193-22a02e265fcd","year":2021},"citing_paper":{"arxiv_id":"2507.19188","last_updated":"2025-07-25T11:57:18Z","snapshot_observed_at":"2026-08-18T11:07:02.491563Z","submitted_at":"2025-07-25T11:57:18Z","title":"VisHall3D: Monocular Semantic Scene Completion from Reconstructing the Visible Regions to Hallucinating the Invisible Regions","version":1},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-08-15T18:03:31.766956Z"},"links":{"citing_paper":"/paper/2507.19188"},"observation_digest":"sha256:589ea8dc3edf24f5b86d9c6643c9f6535c59830eb24bcd2a900c7b51453fd390","observation_id":"b6adeb6f-0797-40dd-b559-2a3bb607ae3f","resolution":{"observed_at":"2026-08-15T18:03:32.811900Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2302.13540","last_updated":"2023-02-27T06:35:03Z","snapshot_observed_at":"2026-08-16T15:52:32.847801Z","submitted_at":"2023-02-27T06:35:03Z","title":"OccDepth: A Depth-Aware Method for 3D Semantic Scene Completion","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2302.13540","snapshot_observed_at":"2026-08-15T18:03:31.837079Z","title":"Occdepth: A depth-aware method for 3d semantic scene completion","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2507.19188","last_updated":"2025-07-25T11:57:18Z","snapshot_observed_at":"2026-08-18T11:07:02.491563Z","submitted_at":"2025-07-25T11:57:18Z","title":"VisHall3D: Monocular Semantic Scene Completion from Reconstructing the Visible Regions to Hallucinating the Invisible Regions","version":1},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-08-15T18:03:31.837079Z"},"links":{"cited_paper":"/paper/2302.13540","citing_paper":"/paper/2507.19188"},"observation_digest":"sha256:01cdc049391fd1b3e47fbb3ef00f23f7da53cbdbac41555a78c6646e45d58d9c","observation_id":"449c183c-f8a5-4464-908c-2847680c801d","resolution":{"observed_at":"2026-08-15T18:03:31.837079Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T18:03:32.794285Z","title":"Lift, splat, shoot: Encoding images from arbitrary camera rigs by implicitly unproject- ing to 3d","venue":null,"work_id":"386577d1-054c-48f5-a092-839dca3813f8","year":2020},"citing_paper":{"arxiv_id":"2507.19188","last_updated":"2025-07-25T11:57:18Z","snapshot_observed_at":"2026-08-18T11:07:02.491563Z","submitted_at":"2025-07-25T11:57:18Z","title":"VisHall3D: Monocular Semantic Scene Completion from Reconstructing the Visible Regions to Hallucinating the Invisible Regions","version":1},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-08-15T18:03:31.924494Z"},"links":{"citing_paper":"/paper/2507.19188"},"observation_digest":"sha256:306238f110acd35dfcf0ec67a08a4ae88ba674c13d0bfb687dadde3a89e859f2","observation_id":"60f16613-2c57-40e7-9f8a-7e6d5c57f39a","resolution":{"observed_at":"2026-08-15T18:03:32.798999Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T18:03:32.006787Z","title":"Semantic scene completion using local deep implicit functions on lidar data.IEEE transactions on pattern analysis and machine intelligence, 44(10):7205– 7218, 2021","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2507.19188","last_updated":"2025-07-25T11:57:18Z","snapshot_observed_at":"2026-08-18T11:07:02.491563Z","submitted_at":"2025-07-25T11:57:18Z","title":"VisHall3D: Monocular Semantic Scene Completion from Reconstructing the Visible Regions to Hallucinating the Invisible Regions","version":1},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-08-15T18:03:32.006787Z"},"links":{"citing_paper":"/paper/2507.19188"},"observation_digest":"sha256:579e0e6071024ffb692c84d962f1748d776ac2cdce77b7d4722ca95dcc5e7daa","observation_id":"dfb7c8d6-825f-4668-9aa7-53fa65ee359b","resolution":{"observed_at":"2026-08-15T18:03:32.006787Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T18:03:32.776159Z","title":"Lmscnet: Lightweight multiscale 3d semantic com- pletion","venue":null,"work_id":"f519dd9a-8096-4fc8-a9ba-f3c7b0b0742d","year":2020},"citing_paper":{"arxiv_id":"2507.19188","last_updated":"2025-07-25T11:57:18Z","snapshot_observed_at":"2026-08-18T11:07:02.491563Z","submitted_at":"2025-07-25T11:57:18Z","title":"VisHall3D: Monocular Semantic Scene Completion from Reconstructing the Visible Regions to Hallucinating the Invisible Regions","version":1},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-08-15T18:03:32.037846Z"},"links":{"citing_paper":"/paper/2507.19188"},"observation_digest":"sha256:ee004d4c1a5ec6afdaaca153d1981737114dfc63083fc2f68b3275321ded828e","observation_id":"17d056ca-fadf-43fa-9951-e46a5cf58744","resolution":{"observed_at":"2026-08-15T18:03:32.780144Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T18:03:32.764760Z","title":"Mobilestereonet: Towards lightweight deep net- works for stereo matching","venue":null,"work_id":"5e655644-29d7-4e2f-ada4-95176894698b","year":2022},"citing_paper":{"arxiv_id":"2507.19188","last_updated":"2025-07-25T11:57:18Z","snapshot_observed_at":"2026-08-18T11:07:02.491563Z","submitted_at":"2025-07-25T11:57:18Z","title":"VisHall3D: Monocular Semantic Scene Completion from Reconstructing the Visible Regions to Hallucinating the Invisible Regions","version":1},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-08-15T18:03:32.074939Z"},"links":{"citing_paper":"/paper/2507.19188"},"observation_digest":"sha256:427f8788dde32fa07a4bd2232d3861cd00987ff6afb7804e075eb86843483ffe","observation_id":"510687f7-cef2-40fc-b6bb-04392a01995f","resolution":{"observed_at":"2026-08-15T18:03:32.768509Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T18:03:32.753375Z","title":"Semantic scene com- pletion from a single depth image","venue":null,"work_id":"1d2cf4d4-fc3c-42d8-9919-085f89268376","year":2017},"citing_paper":{"arxiv_id":"2507.19188","last_updated":"2025-07-25T11:57:18Z","snapshot_observed_at":"2026-08-18T11:07:02.491563Z","submitted_at":"2025-07-25T11:57:18Z","title":"VisHall3D: Monocular Semantic Scene Completion from Reconstructing the Visible Regions to Hallucinating the Invisible Regions","version":1},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-08-15T18:03:32.078505Z"},"links":{"citing_paper":"/paper/2507.19188"},"observation_digest":"sha256:99c2ce2eb342862d8ad31db0f56bba8e88b1cd1d50fcba87b1afc902978b8aac","observation_id":"ea7234ba-cf01-4870-baae-9b9d11a5a52d","resolution":{"observed_at":"2026-08-15T18:03:32.757040Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T18:03:32.712415Z","title":"Sparse r-cnn: End-to-end ob- ject detection with learnable proposals","venue":null,"work_id":"dc3f03be-cd11-4352-8604-29bc03d053bd","year":2021},"citing_paper":{"arxiv_id":"2507.19188","last_updated":"2025-07-25T11:57:18Z","snapshot_observed_at":"2026-08-18T11:07:02.491563Z","submitted_at":"2025-07-25T11:57:18Z","title":"VisHall3D: Monocular Semantic Scene Completion from Reconstructing the Visible Regions to Hallucinating the Invisible Regions","version":1},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-08-15T18:03:32.082300Z"},"links":{"citing_paper":"/paper/2507.19188"},"observation_digest":"sha256:59e02a7f5a130e8fa0935f2a68e05cef5c39de003ab2546a1bd36f6ff51c4efe","observation_id":"8b2c6904-c2f7-469c-ac76-958b3f9e6ec7","resolution":{"observed_at":"2026-08-15T18:03:32.744867Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T18:03:32.537270Z","title":"Not all voxels are equal: Hardness-aware semantic scene completion with self- distillation","venue":null,"work_id":"446111fe-866d-4d09-88e7-eb2e20b9cd5a","year":2024},"citing_paper":{"arxiv_id":"2507.19188","last_updated":"2025-07-25T11:57:18Z","snapshot_observed_at":"2026-08-18T11:07:02.491563Z","submitted_at":"2025-07-25T11:57:18Z","title":"VisHall3D: Monocular Semantic Scene Completion from Reconstructing the Visible Regions to Hallucinating the Invisible Regions","version":1},"reference_index":36,"source":"pdf_text","source_observed_at":"2026-08-15T18:03:32.086054Z"},"links":{"citing_paper":"/paper/2507.19188"},"observation_digest":"sha256:7dc0274663066a4f8b0c2c8c34bccdd5dd4cfb8cef94499c9b546a8e896134f0","observation_id":"d7d8d1a5-7d95-42a6-9989-ae22ac63cb97","resolution":{"observed_at":"2026-08-15T18:03:32.623252Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T18:03:32.524142Z","title":"H2gformer: Horizontal-to-global voxel transformer for 3d semantic scene completion","venue":null,"work_id":"9e39d43a-9a83-4fd2-bfa8-dda78b38fea1","year":2024},"citing_paper":{"arxiv_id":"2507.19188","last_updated":"2025-07-25T11:57:18Z","snapshot_observed_at":"2026-08-18T11:07:02.491563Z","submitted_at":"2025-07-25T11:57:18Z","title":"VisHall3D: Monocular Semantic Scene Completion from Reconstructing the Visible Regions to Hallucinating the Invisible Regions","version":1},"reference_index":37,"source":"pdf_text","source_observed_at":"2026-08-15T18:03:32.090049Z"},"links":{"citing_paper":"/paper/2507.19188"},"observation_digest":"sha256:625d204d859c21fa47ec12e63c674c6fd66a0720b063f18c5b08f1b3c4dff243","observation_id":"563bbb0e-996c-49b7-8b33-f22d088d9fac","resolution":{"observed_at":"2026-08-15T18:03:32.529078Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T18:03:32.511339Z","title":"Surroundocc: Multi-camera 3d occu- pancy prediction for autonomous driving","venue":null,"work_id":"ee517e0c-677f-4d69-a7eb-4601e4517cc2","year":2023},"citing_paper":{"arxiv_id":"2507.19188","last_updated":"2025-07-25T11:57:18Z","snapshot_observed_at":"2026-08-18T11:07:02.491563Z","submitted_at":"2025-07-25T11:57:18Z","title":"VisHall3D: Monocular Semantic Scene Completion from Reconstructing the Visible Regions to Hallucinating the Invisible Regions","version":1},"reference_index":38,"source":"pdf_text","source_observed_at":"2026-08-15T18:03:32.093848Z"},"links":{"citing_paper":"/paper/2507.19188"},"observation_digest":"sha256:f2958d2bee12034c76b256a71319bd48188d7fc1d715f143adf6be6047b0b8b9","observation_id":"f3c998ad-ef98-4da1-a23b-0fde0348a9a2","resolution":{"observed_at":"2026-08-15T18:03:32.515297Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T18:03:32.500210Z","title":"Instance-aware monocular 3d semantic scene comple- tion.IEEE Transactions on Intelligent Transportation Sys- tems, 25(7):6543–6554, 2024","venue":null,"work_id":"77f92710-e69d-4d12-817d-989c54575d47","year":2024},"citing_paper":{"arxiv_id":"2507.19188","last_updated":"2025-07-25T11:57:18Z","snapshot_observed_at":"2026-08-18T11:07:02.491563Z","submitted_at":"2025-07-25T11:57:18Z","title":"VisHall3D: Monocular Semantic Scene Completion from Reconstructing the Visible Regions to Hallucinating the Invisible Regions","version":1},"reference_index":39,"source":"pdf_text","source_observed_at":"2026-08-15T18:03:32.097697Z"},"links":{"citing_paper":"/paper/2507.19188"},"observation_digest":"sha256:10ef762146563201cda20949932fe9e57aa7ce5d2c98440ce14e7a061d4a22da","observation_id":"c8a8642d-0d71-4cae-90c5-fd3008381272","resolution":{"observed_at":"2026-08-15T18:03:32.504086Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T18:03:32.489166Z","title":"Sparse single sweep lidar point cloud segmentation via learning contextual shape priors from scene completion","venue":null,"work_id":"c0cf693f-5810-460a-ad05-bb489eb2775b","year":2021},"citing_paper":{"arxiv_id":"2507.19188","last_updated":"2025-07-25T11:57:18Z","snapshot_observed_at":"2026-08-18T11:07:02.491563Z","submitted_at":"2025-07-25T11:57:18Z","title":"VisHall3D: Monocular Semantic Scene Completion from Reconstructing the Visible Regions to Hallucinating the Invisible Regions","version":1},"reference_index":40,"source":"pdf_text","source_observed_at":"2026-08-15T18:03:32.100669Z"},"links":{"citing_paper":"/paper/2507.19188"},"observation_digest":"sha256:a8bdba6231c3b400e04e20f62a84d2f0c490f408ea1fb5fb08ead2a556f09f0f","observation_id":"057b078f-2783-456c-8c60-9bdeec435e14","resolution":{"observed_at":"2026-08-15T18:03:32.492770Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2311.17084","last_updated":"2024-11-25T23:13:35Z","snapshot_observed_at":"2026-08-18T15:16:54.078186Z","submitted_at":"2023-11-28T01:47:51Z","title":"DepthSSC: Monocular 3D Semantic Scene Completion via Depth-Spatial Alignment and Voxel Adaptation","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2311.17084","snapshot_observed_at":"2026-08-15T18:03:32.104420Z","title":"Depthssc: Depth- spatial alignment and dynamic voxel resolution for monoc- ular 3d semantic scene completion.arXiv preprint arXiv:2311.17084, 2023","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2507.19188","last_updated":"2025-07-25T11:57:18Z","snapshot_observed_at":"2026-08-18T11:07:02.491563Z","submitted_at":"2025-07-25T11:57:18Z","title":"VisHall3D: Monocular Semantic Scene Completion from Reconstructing the Visible Regions to Hallucinating the Invisible Regions","version":1},"reference_index":41,"source":"pdf_text","source_observed_at":"2026-08-15T18:03:32.104420Z"},"links":{"cited_paper":"/paper/2311.17084","citing_paper":"/paper/2507.19188"},"observation_digest":"sha256:c71b055129819b2a868305bd5d6c3cfe1e65ba2039edc39a1408da5e6aa0e1d6","observation_id":"afdc7ac4-0d75-46e5-8a98-0cc42593b004","resolution":{"observed_at":"2026-08-15T18:03:32.104420Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T18:03:32.477686Z","title":"Ndc-scene: Boost monocular 3d semantic scene completion in normalized de- vice coordinates space","venue":null,"work_id":"ab706aec-18f5-437e-97d7-3f295b3872f5","year":2023},"citing_paper":{"arxiv_id":"2507.19188","last_updated":"2025-07-25T11:57:18Z","snapshot_observed_at":"2026-08-18T11:07:02.491563Z","submitted_at":"2025-07-25T11:57:18Z","title":"VisHall3D: Monocular Semantic Scene Completion from Reconstructing the Visible Regions to Hallucinating the Invisible Regions","version":1},"reference_index":42,"source":"pdf_text","source_observed_at":"2026-08-15T18:03:32.108675Z"},"links":{"citing_paper":"/paper/2507.19188"},"observation_digest":"sha256:4fab4e820ea006038010d789e5ec310f08c10d361ac33a75670f53861d21a303","observation_id":"d5fcc943-dd21-4211-ac76-835e9f71d76c","resolution":{"observed_at":"2026-08-15T18:03:32.481641Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T18:03:32.464223Z","title":"Context and geometry aware voxel transformer for semantic scene completion","venue":null,"work_id":"3137b28d-5cb1-4e6d-8102-ff4699e07f59","year":2024},"citing_paper":{"arxiv_id":"2507.19188","last_updated":"2025-07-25T11:57:18Z","snapshot_observed_at":"2026-08-18T11:07:02.491563Z","submitted_at":"2025-07-25T11:57:18Z","title":"VisHall3D: Monocular Semantic Scene Completion from Reconstructing the Visible Regions to Hallucinating the Invisible Regions","version":1},"reference_index":43,"source":"pdf_text","source_observed_at":"2026-08-15T18:03:32.112665Z"},"links":{"citing_paper":"/paper/2507.19188"},"observation_digest":"sha256:60e7f44eae6d83e634f1aaa50991d574ad2b279097136bc183bea99a45505d9a","observation_id":"24fb81ba-868b-4be3-ba1b-dccd5dfdbd13","resolution":{"observed_at":"2026-08-15T18:03:32.468105Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T18:03:32.116204Z","title":"Monodetr: Depth- guided transformer for monocular 3d object detection","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2507.19188","last_updated":"2025-07-25T11:57:18Z","snapshot_observed_at":"2026-08-18T11:07:02.491563Z","submitted_at":"2025-07-25T11:57:18Z","title":"VisHall3D: Monocular Semantic Scene Completion from Reconstructing the Visible Regions to Hallucinating the Invisible Regions","version":1},"reference_index":44,"source":"pdf_text","source_observed_at":"2026-08-15T18:03:32.116204Z"},"links":{"citing_paper":"/paper/2507.19188"},"observation_digest":"sha256:2cddca52e338f3d91aafeb0b983ab651a21cb845a451977c1afc5b6944571146","observation_id":"23348d6e-d61a-4b72-b26a-f708df0d8f7b","resolution":{"observed_at":"2026-08-15T18:03:32.116204Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T18:03:32.446637Z","title":"Objects are differ- ent: Flexible monocular 3d object detection","venue":null,"work_id":"435476be-3fa6-424b-8510-1d2729d2ab00","year":2021},"citing_paper":{"arxiv_id":"2507.19188","last_updated":"2025-07-25T11:57:18Z","snapshot_observed_at":"2026-08-18T11:07:02.491563Z","submitted_at":"2025-07-25T11:57:18Z","title":"VisHall3D: Monocular Semantic Scene Completion from Reconstructing the Visible Regions to Hallucinating the Invisible Regions","version":1},"reference_index":45,"source":"pdf_text","source_observed_at":"2026-08-15T18:03:32.122039Z"},"links":{"citing_paper":"/paper/2507.19188"},"observation_digest":"sha256:43fb2533aa1b9ad90c141477ea61e01a9b887187531e9f14a347f2a9d745e378","observation_id":"d1691aa4-d92f-4389-8beb-0ecf1961a911","resolution":{"observed_at":"2026-08-15T18:03:32.450534Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T18:03:32.125757Z","title":"Occformer: Dual-path transformer for vision-based 3d semantic occu- pancy prediction","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2507.19188","last_updated":"2025-07-25T11:57:18Z","snapshot_observed_at":"2026-08-18T11:07:02.491563Z","submitted_at":"2025-07-25T11:57:18Z","title":"VisHall3D: Monocular Semantic Scene Completion from Reconstructing the Visible Regions to Hallucinating the Invisible Regions","version":1},"reference_index":46,"source":"pdf_text","source_observed_at":"2026-08-15T18:03:32.125757Z"},"links":{"citing_paper":"/paper/2507.19188"},"observation_digest":"sha256:617f5ec3363270e437f4f7602ebb338b20b2be9eb52e856b663afb0ecbe969d1","observation_id":"5806ed3e-b085-406e-9d3d-32b994865e0e","resolution":{"observed_at":"2026-08-15T18:03:32.125757Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T18:03:32.324321Z","title":"Monoocc: Digging into monocular semantic occu- pancy prediction","venue":null,"work_id":"029f86c7-456e-4243-b98a-0a82bdac0155","year":2024},"citing_paper":{"arxiv_id":"2507.19188","last_updated":"2025-07-25T11:57:18Z","snapshot_observed_at":"2026-08-18T11:07:02.491563Z","submitted_at":"2025-07-25T11:57:18Z","title":"VisHall3D: Monocular Semantic Scene Completion from Reconstructing the Visible Regions to Hallucinating the Invisible Regions","version":1},"reference_index":47,"source":"pdf_text","source_observed_at":"2026-08-15T18:03:32.130056Z"},"links":{"citing_paper":"/paper/2507.19188"},"observation_digest":"sha256:a619b75d351439b2e523add1ca17a8eedc55c0526097eaa2f19ac6b89399eb20","observation_id":"7e336697-b38e-4946-8f45-8230c5668618","resolution":{"observed_at":"2026-08-15T18:03:32.431581Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1904.07850","last_updated":"2019-04-25T16:20:02Z","snapshot_observed_at":"2026-08-14T16:45:31.678245Z","submitted_at":"2019-04-16T17:54:26Z","title":"Objects as Points","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1904.07850","snapshot_observed_at":"2026-08-15T18:03:32.133540Z","title":"Ob- jects as points.arXiv preprint arXiv:1904.07850, 2019","venue":null,"work_id":null,"year":1904},"citing_paper":{"arxiv_id":"2507.19188","last_updated":"2025-07-25T11:57:18Z","snapshot_observed_at":"2026-08-18T11:07:02.491563Z","submitted_at":"2025-07-25T11:57:18Z","title":"VisHall3D: Monocular Semantic Scene Completion from Reconstructing the Visible Regions to Hallucinating the Invisible Regions","version":1},"reference_index":48,"source":"pdf_text","source_observed_at":"2026-08-15T18:03:32.133540Z"},"links":{"cited_paper":"/paper/1904.07850","citing_paper":"/paper/2507.19188"},"observation_digest":"sha256:774b5126fab173098a86f679c7912eabc488b1581544826137c2d892f77c39e0","observation_id":"a1efe672-2761-41e2-994d-a98ecde66b7b","resolution":{"observed_at":"2026-08-15T18:03:32.133540Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2010.04159","last_updated":"2021-03-18T03:14:26Z","snapshot_observed_at":"2026-08-13T17:54:01.724774Z","submitted_at":"2020-10-08T17:59:21Z","title":"Deformable DETR: Deformable Transformers for End-to-End Object Detection","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2010.04159","snapshot_observed_at":"2026-08-15T18:03:32.139207Z","title":"Deformable detr: Deformable trans- formers for end-to-end object detection.arXiv preprint arXiv:2010.04159, 2020","venue":null,"work_id":null,"year":2010},"citing_paper":{"arxiv_id":"2507.19188","last_updated":"2025-07-25T11:57:18Z","snapshot_observed_at":"2026-08-18T11:07:02.491563Z","submitted_at":"2025-07-25T11:57:18Z","title":"VisHall3D: Monocular Semantic Scene Completion from Reconstructing the Visible Regions to Hallucinating the Invisible Regions","version":1},"reference_index":49,"source":"pdf_text","source_observed_at":"2026-08-15T18:03:32.139207Z"},"links":{"cited_paper":"/paper/2010.04159","citing_paper":"/paper/2507.19188"},"observation_digest":"sha256:da5ddbb956ee64f471c7c91316e9f6dfb9eb1179b49a7e7052adddbbfe2e9406","observation_id":"65620872-528c-4979-99cc-e5fc9213e059","resolution":{"observed_at":"2026-08-15T18:03:32.139207Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"paper":{"arxiv_id":"2507.19188","last_updated":"2025-07-25T11:57:18Z","latest_version":1,"primary_category":"cs.CV","snapshot_observed_at":"2026-08-18T11:07:02.491563Z","submitted_at":"2025-07-25T11:57:18Z","title":"VisHall3D: Monocular Semantic Scene Completion from Reconstructing the Visible Regions to Hallucinating the Invisible Regions"},"reference_resolution":{"displayed":49,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":16,"verified_exact":1,"verified_fuzzy":32},"total_outbound_references":49},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"thesis":"As of 19 August 2026, this Paper Citation Record lists 49 of 49 outbound references and 0 inbound Pith citation observations for arXiv:2507.19188."}