{"as_of":"2026-08-09T19:52:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:d314a9ceee36198f5d5dca69ebc7b7e1e404f3a34a240c2f071ed5777a6b33b1","coverage":[{"denominator":41,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":41,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-06T16:25:08.938621Z","state":"measured"},{"denominator":41,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":41,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-09T06:31:02.800959+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2507.13801/citation-record","integrity":"/paper/2507.13801/integrity","json":"/paper/2507.13801/citation-record.json","paper":"/paper/2507.13801"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T16:25:09.491693Z","title":"Semantickitti: A dataset for semantic scene understanding of lidar sequences,","venue":null,"work_id":"7780286e-1ebb-4bba-8a9a-8213e6ccff0a","year":2019},"citing_paper":{"arxiv_id":"2507.13801","last_updated":"2025-07-18T10:24:58Z","snapshot_observed_at":"2026-08-07T21:50:37.650757Z","submitted_at":"2025-07-18T10:24:58Z","title":"One Step Closer: Creating the Future to Boost Monocular Semantic Scene Completion","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-06T16:25:05.932564Z"},"links":{"citing_paper":"/paper/2507.13801"},"observation_digest":"sha256:d46f6d518e5b5acfbc6e366ca68dba65da0ecaac44be4002a688bc9ac48adaf9","observation_id":"9e0ef205-5f0f-4b79-999c-e40fede37fdf","resolution":{"observed_at":"2026-08-06T16:25:09.495868Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T16:25:09.477747Z","title":"Sscbench: A large-scale 3d semantic scene completion benchmark for autonomous driving,","venue":null,"work_id":"0e4ab1b7-563c-47be-8d3f-af22191b2a04","year":2024},"citing_paper":{"arxiv_id":"2507.13801","last_updated":"2025-07-18T10:24:58Z","snapshot_observed_at":"2026-08-07T21:50:37.650757Z","submitted_at":"2025-07-18T10:24:58Z","title":"One Step Closer: Creating the Future to Boost Monocular Semantic Scene Completion","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-06T16:25:06.030124Z"},"links":{"citing_paper":"/paper/2507.13801"},"observation_digest":"sha256:843f8ca8e068a964e03ad055d7a953a1fa9ec539676868edfa5e64eaf7ff8ca6","observation_id":"3e0f2737-86e0-4692-9a3b-5a4423d1a2db","resolution":{"observed_at":"2026-08-06T16:25:09.482329Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T16:25:06.116771Z","title":"Kitti-360: A novel dataset and benchmarks for urban scene understanding in 2d and 3d,","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2507.13801","last_updated":"2025-07-18T10:24:58Z","snapshot_observed_at":"2026-08-07T21:50:37.650757Z","submitted_at":"2025-07-18T10:24:58Z","title":"One Step Closer: Creating the Future to Boost Monocular Semantic Scene Completion","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-06T16:25:06.116771Z"},"links":{"citing_paper":"/paper/2507.13801"},"observation_digest":"sha256:57ddaefd13f8e4ad9db2f4be26e8d0fe85d8617abdb4c093488a238205fc306b","observation_id":"5a56f0d2-eca1-4ec1-81bf-7cffc2cd5cf4","resolution":{"observed_at":"2026-08-06T16:25:06.116771Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T16:25:09.454284Z","title":"Semantic scene completion from a single depth image,","venue":null,"work_id":"38f2a432-2b13-4444-89ac-b22796c6f204","year":2017},"citing_paper":{"arxiv_id":"2507.13801","last_updated":"2025-07-18T10:24:58Z","snapshot_observed_at":"2026-08-07T21:50:37.650757Z","submitted_at":"2025-07-18T10:24:58Z","title":"One Step Closer: Creating the Future to Boost Monocular Semantic Scene Completion","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-06T16:25:06.220737Z"},"links":{"citing_paper":"/paper/2507.13801"},"observation_digest":"sha256:3eb02caaa662569bc101db8cea2f4dba290b6934afad12ff583f8a4b7caa1fb7","observation_id":"47d99d8d-c7bb-4bff-9405-8e741d9a0406","resolution":{"observed_at":"2026-08-06T16:25:09.458605Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T16:25:09.439793Z","title":"Lmscnet: Lightweight multiscale 3d semantic completion,","venue":null,"work_id":"bd984a26-f8af-4e8c-8353-bfeea1efa541","year":2020},"citing_paper":{"arxiv_id":"2507.13801","last_updated":"2025-07-18T10:24:58Z","snapshot_observed_at":"2026-08-07T21:50:37.650757Z","submitted_at":"2025-07-18T10:24:58Z","title":"One Step Closer: Creating the Future to Boost Monocular Semantic Scene Completion","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-06T16:25:06.321513Z"},"links":{"citing_paper":"/paper/2507.13801"},"observation_digest":"sha256:9807810f1e752d2cb7376c566772858c178379fea33276d8e3c4da9e5a7982ca","observation_id":"304e4f16-e4ff-4b36-bbe5-8a8438414b2e","resolution":{"observed_at":"2026-08-06T16:25:09.444184Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T16:25:09.426222Z","title":"Sparse single sweep lidar point cloud segmentation via learning contextual shape priors from scene completion,","venue":null,"work_id":"ada45816-2af6-416e-aa80-65e07881bcb9","year":2021},"citing_paper":{"arxiv_id":"2507.13801","last_updated":"2025-07-18T10:24:58Z","snapshot_observed_at":"2026-08-07T21:50:37.650757Z","submitted_at":"2025-07-18T10:24:58Z","title":"One Step Closer: Creating the Future to Boost Monocular Semantic Scene Completion","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-06T16:25:06.418869Z"},"links":{"citing_paper":"/paper/2507.13801"},"observation_digest":"sha256:1915a9b086e66597f50f33689576a8163f795964245c16635b3ee6127bfd5ba1","observation_id":"f71bdece-a9b4-41dc-bf6e-e6ba3975ba0c","resolution":{"observed_at":"2026-08-06T16:25:09.430315Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2303.13959","last_updated":"2024-05-06T15:14:22Z","snapshot_observed_at":"2026-07-06T15:07:37.299096Z","submitted_at":"2023-03-24T12:33:44Z","title":"Bridging Stereo Geometry and BEV Representation with Reliable Mutual Interaction for Semantic Scene Completion","version":6},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2303.13959","snapshot_observed_at":"2026-08-06T16:25:06.553649Z","title":"Bridging stereo geometry and bev representation with reliable mutual interaction for semantic scene completion,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2507.13801","last_updated":"2025-07-18T10:24:58Z","snapshot_observed_at":"2026-08-07T21:50:37.650757Z","submitted_at":"2025-07-18T10:24:58Z","title":"One Step Closer: Creating the Future to Boost Monocular Semantic Scene Completion","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-06T16:25:06.553649Z"},"links":{"cited_paper":"/paper/2303.13959","citing_paper":"/paper/2507.13801"},"observation_digest":"sha256:ba92626583acde9db1f350a6f9718d5e9055a2002502b69c40d0811880685a7f","observation_id":"e7496204-ba20-4f45-b62b-75212f62632b","resolution":{"observed_at":"2026-08-06T16:25:06.553649Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2407.02077","last_updated":"2024-11-06T05:11:24Z","snapshot_observed_at":"2026-07-06T18:40:10.103133Z","submitted_at":"2024-07-02T09:11:17Z","title":"Hierarchical Temporal Context Learning for Camera-based Semantic Scene Completion","version":4},"cited_work":{"arxiv_id":"2407.02077","doi":null,"metadata_source":"pith","pith_arxiv_id":"2407.02077","snapshot_observed_at":"2026-08-06T16:25:09.025681Z","title":"Hierarchical Temporal Context Learning for Camera-based Semantic Scene Completion","venue":"cs.CV","work_id":"35f324dd-cdcc-4de4-989e-ce1814b76cce","year":2024},"citing_paper":{"arxiv_id":"2507.13801","last_updated":"2025-07-18T10:24:58Z","snapshot_observed_at":"2026-08-07T21:50:37.650757Z","submitted_at":"2025-07-18T10:24:58Z","title":"One Step Closer: Creating the Future to Boost Monocular Semantic Scene Completion","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-06T16:25:06.693012Z"},"links":{"cited_paper":"/paper/2407.02077","citing_paper":"/paper/2507.13801"},"observation_digest":"sha256:52cdeeae0aae64bb86835ff97b901cf36042d45822fcf72afe54c399b0e087f2","observation_id":"2bdcee4a-7924-4b8f-b9f2-62b5a8eff7f5","resolution":{"observed_at":"2026-08-06T16:25:09.030125Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T16:25:06.820851Z","title":"Tri-perspective view for vision-based 3d semantic occupancy prediction,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2507.13801","last_updated":"2025-07-18T10:24:58Z","snapshot_observed_at":"2026-08-07T21:50:37.650757Z","submitted_at":"2025-07-18T10:24:58Z","title":"One Step Closer: Creating the Future to Boost Monocular Semantic Scene Completion","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-06T16:25:06.820851Z"},"links":{"citing_paper":"/paper/2507.13801"},"observation_digest":"sha256:1b591bcae42023961ae221323f14280e61271029eb3914b959a8e3a25ae071ce","observation_id":"1478643b-78ae-4a3c-b033-c471df660cfc","resolution":{"observed_at":"2026-08-06T16:25:06.820851Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T16:25:06.915204Z","title":"Monoscene: Monocular 3d semantic scene completion,","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2507.13801","last_updated":"2025-07-18T10:24:58Z","snapshot_observed_at":"2026-08-07T21:50:37.650757Z","submitted_at":"2025-07-18T10:24:58Z","title":"One Step Closer: Creating the Future to Boost Monocular Semantic Scene Completion","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-06T16:25:06.915204Z"},"links":{"citing_paper":"/paper/2507.13801"},"observation_digest":"sha256:7035e9fbeda2992a6ded884973f6adc3e41b7d51e189a063a8745b17f26b89e6","observation_id":"8eedf067-3c1c-4384-a032-033d2ed5c4e1","resolution":{"observed_at":"2026-08-06T16:25:06.915204Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T16:25:09.394780Z","title":"Ndc- scene: Boost monocular 3d semantic scene completion in normalized device coordinates space,","venue":null,"work_id":"e349f198-b43c-4d90-854b-fe3bdb95b922","year":2023},"citing_paper":{"arxiv_id":"2507.13801","last_updated":"2025-07-18T10:24:58Z","snapshot_observed_at":"2026-08-07T21:50:37.650757Z","submitted_at":"2025-07-18T10:24:58Z","title":"One Step Closer: Creating the Future to Boost Monocular Semantic Scene Completion","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-06T16:25:06.977804Z"},"links":{"citing_paper":"/paper/2507.13801"},"observation_digest":"sha256:390683a08630bbcabd929004af90e4d59c181a15b4a2b017ba9d4f8d0d5e45c2","observation_id":"dbc4ac43-1153-439a-81ac-a8aa2461520f","resolution":{"observed_at":"2026-08-06T16:25:09.398640Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T16:25:09.381358Z","title":"Symphonize 3d semantic scene completion with contextual instance queries,","venue":null,"work_id":"c54714a7-fabc-4738-9e00-b90bb33ef5af","year":2024},"citing_paper":{"arxiv_id":"2507.13801","last_updated":"2025-07-18T10:24:58Z","snapshot_observed_at":"2026-08-07T21:50:37.650757Z","submitted_at":"2025-07-18T10:24:58Z","title":"One Step Closer: Creating the Future to Boost Monocular Semantic Scene Completion","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-06T16:25:07.059126Z"},"links":{"citing_paper":"/paper/2507.13801"},"observation_digest":"sha256:e479c507e7274e463f3096bfbd3af893c96df0f2228970074609431ecf624ac8","observation_id":"a66d3407-f266-47d4-8e92-2d4af133639e","resolution":{"observed_at":"2026-08-06T16:25:09.385584Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T16:25:09.368110Z","title":"V oxformer: Sparse voxel transformer for camera-based 3d semantic scene completion,","venue":null,"work_id":"36fbcf3c-6681-4699-8ad5-919afe5cae6c","year":2023},"citing_paper":{"arxiv_id":"2507.13801","last_updated":"2025-07-18T10:24:58Z","snapshot_observed_at":"2026-08-07T21:50:37.650757Z","submitted_at":"2025-07-18T10:24:58Z","title":"One Step Closer: Creating the Future to Boost Monocular Semantic Scene Completion","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-06T16:25:07.191692Z"},"links":{"citing_paper":"/paper/2507.13801"},"observation_digest":"sha256:300841310144ff2fd53e097f5d5a552e7f67fafc94817ca3aac835b70fa0edb6","observation_id":"53f271f2-dd1b-44a6-a797-55170a542207","resolution":{"observed_at":"2026-08-06T16:25:09.372455Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T16:25:09.355184Z","title":"H2gformer: Horizontal-to-global voxel trans- former for 3d semantic scene completion,","venue":null,"work_id":"d55bde14-159e-44be-9335-56a7dd9bc47c","year":2024},"citing_paper":{"arxiv_id":"2507.13801","last_updated":"2025-07-18T10:24:58Z","snapshot_observed_at":"2026-08-07T21:50:37.650757Z","submitted_at":"2025-07-18T10:24:58Z","title":"One Step Closer: Creating the Future to Boost Monocular Semantic Scene Completion","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-06T16:25:07.247991Z"},"links":{"citing_paper":"/paper/2507.13801"},"observation_digest":"sha256:1b703e773709c72c30af337efd50f909496891aca222bb44930205a1e2417020","observation_id":"b477e43c-2c4d-441d-926d-f8442f3d0a4d","resolution":{"observed_at":"2026-08-06T16:25:09.359077Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T16:25:07.337117Z","title":"Monoocc: Digging into monocular semantic occupancy prediction,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.13801","last_updated":"2025-07-18T10:24:58Z","snapshot_observed_at":"2026-08-07T21:50:37.650757Z","submitted_at":"2025-07-18T10:24:58Z","title":"One Step Closer: Creating the Future to Boost Monocular Semantic Scene Completion","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-06T16:25:07.337117Z"},"links":{"citing_paper":"/paper/2507.13801"},"observation_digest":"sha256:c4543835b17bc760541a7e524bc9e9a619926d4fea4f769e45b0eefbb2fe1f4e","observation_id":"4f46b258-37a5-4979-a118-0ba0fb1b5936","resolution":{"observed_at":"2026-08-06T16:25:07.337117Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T16:25:09.333294Z","title":"Anisotropic convolu- tional networks for 3d semantic scene completion,","venue":null,"work_id":"12cb7acd-071b-4ca4-906e-feadd0241fb2","year":2020},"citing_paper":{"arxiv_id":"2507.13801","last_updated":"2025-07-18T10:24:58Z","snapshot_observed_at":"2026-08-07T21:50:37.650757Z","submitted_at":"2025-07-18T10:24:58Z","title":"One Step Closer: Creating the Future to Boost Monocular Semantic Scene Completion","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-06T16:25:07.444842Z"},"links":{"citing_paper":"/paper/2507.13801"},"observation_digest":"sha256:ba092e6d3c9acd8841ee79fee49ca750fb444ff0da79c0d992765f31e8bccd4b","observation_id":"2300a368-de2f-48cd-abdf-59452f9a2904","resolution":{"observed_at":"2026-08-06T16:25:09.337256Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T16:25:09.321220Z","title":"S3cnet: A sparse semantic scene completion network for lidar point clouds,","venue":null,"work_id":"5f20ff3d-8cde-4a1c-843a-ee6624d44101","year":2021},"citing_paper":{"arxiv_id":"2507.13801","last_updated":"2025-07-18T10:24:58Z","snapshot_observed_at":"2026-08-07T21:50:37.650757Z","submitted_at":"2025-07-18T10:24:58Z","title":"One Step Closer: Creating the Future to Boost Monocular Semantic Scene Completion","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-06T16:25:07.557135Z"},"links":{"citing_paper":"/paper/2507.13801"},"observation_digest":"sha256:a0c2690214dc7156a52e5a3ea19b0ac19377eda5d5e0b86df20de8bf0335768a","observation_id":"f84733af-f97e-4b8c-a7a1-d9fce64c7b76","resolution":{"observed_at":"2026-08-06T16:25:09.325138Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T16:25:09.308037Z","title":"Bevformer: learning bird’s-eye-view representation from lidar-camera via spatiotemporal transformers,","venue":null,"work_id":"42cc23ba-1644-4da9-b886-f911e68a6b06","year":2024},"citing_paper":{"arxiv_id":"2507.13801","last_updated":"2025-07-18T10:24:58Z","snapshot_observed_at":"2026-08-07T21:50:37.650757Z","submitted_at":"2025-07-18T10:24:58Z","title":"One Step Closer: Creating the Future to Boost Monocular Semantic Scene Completion","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-06T16:25:07.617314Z"},"links":{"citing_paper":"/paper/2507.13801"},"observation_digest":"sha256:31d66b5a48451ef300f631003ccece793aa07530abf31ffa31a01b88e52247c6","observation_id":"0b19aad3-4f30-4dd8-a59d-e4eb697d3d72","resolution":{"observed_at":"2026-08-06T16:25:09.311935Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T16:25:09.295060Z","title":"Cvt-occ: Cost volume temporal fusion for 3d occupancy prediction,","venue":null,"work_id":"3ec3ed09-aca8-45ec-9f66-615bc2a3dea7","year":2024},"citing_paper":{"arxiv_id":"2507.13801","last_updated":"2025-07-18T10:24:58Z","snapshot_observed_at":"2026-08-07T21:50:37.650757Z","submitted_at":"2025-07-18T10:24:58Z","title":"One Step Closer: Creating the Future to Boost Monocular Semantic Scene Completion","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-06T16:25:07.694999Z"},"links":{"citing_paper":"/paper/2507.13801"},"observation_digest":"sha256:5dea05afe9106470755041cbbd92d2d87de7f437fa2f482e10a01e73f8941058","observation_id":"aeab451d-d043-474c-842f-0ae0eeadb150","resolution":{"observed_at":"2026-08-06T16:25:09.299436Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T16:25:09.281741Z","title":"Not all voxels are equal: Hardness-aware semantic scene completion with self-distillation,","venue":null,"work_id":"26fae0ab-c3d6-4116-8f40-84b8fcc6d2c0","year":2024},"citing_paper":{"arxiv_id":"2507.13801","last_updated":"2025-07-18T10:24:58Z","snapshot_observed_at":"2026-08-07T21:50:37.650757Z","submitted_at":"2025-07-18T10:24:58Z","title":"One Step Closer: Creating the Future to Boost Monocular Semantic Scene Completion","version":1},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-06T16:25:07.819271Z"},"links":{"citing_paper":"/paper/2507.13801"},"observation_digest":"sha256:14d6db4cf363225edec43c9248c80287e9d4649fc08d3e99ae62317cce0ca9ea","observation_id":"2eeb92dc-efc1-4bad-8f31-12c3ed48f41a","resolution":{"observed_at":"2026-08-06T16:25:09.286348Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T16:25:09.268895Z","title":"Optimizing video prediction via video frame interpolation,","venue":null,"work_id":"e5844792-fd54-4640-ade5-3cc2c719f165","year":2022},"citing_paper":{"arxiv_id":"2507.13801","last_updated":"2025-07-18T10:24:58Z","snapshot_observed_at":"2026-08-07T21:50:37.650757Z","submitted_at":"2025-07-18T10:24:58Z","title":"One Step Closer: Creating the Future to Boost Monocular Semantic Scene Completion","version":1},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-06T16:25:07.871397Z"},"links":{"citing_paper":"/paper/2507.13801"},"observation_digest":"sha256:9e939d90f45d9f0addd2a532a7af7f4ca942cd708e5862a6dfbca8ed315f64d8","observation_id":"d01bd9e4-db5d-4bf3-8f5d-92f6289b8f06","resolution":{"observed_at":"2026-08-06T16:25:09.272974Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T16:25:09.254918Z","title":"A dynamic multi- scale voxel flow network for video prediction,","venue":null,"work_id":"a8366718-e7dc-48ce-8a07-50a98304771b","year":2023},"citing_paper":{"arxiv_id":"2507.13801","last_updated":"2025-07-18T10:24:58Z","snapshot_observed_at":"2026-08-07T21:50:37.650757Z","submitted_at":"2025-07-18T10:24:58Z","title":"One Step Closer: Creating the Future to Boost Monocular Semantic Scene Completion","version":1},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-06T16:25:07.988219Z"},"links":{"citing_paper":"/paper/2507.13801"},"observation_digest":"sha256:15335a6acc714c8bc795619afef062165a078c8e9a933ca90d94320b06b93557","observation_id":"2c89f6e4-6a80-4ac7-abd1-b128d951c7cd","resolution":{"observed_at":"2026-08-06T16:25:09.259700Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T16:25:09.241274Z","title":"Channel attention is all you need for video frame interpolation,","venue":null,"work_id":"aaceac80-e0ad-4c86-a526-bbc58dbc009a","year":2020},"citing_paper":{"arxiv_id":"2507.13801","last_updated":"2025-07-18T10:24:58Z","snapshot_observed_at":"2026-08-07T21:50:37.650757Z","submitted_at":"2025-07-18T10:24:58Z","title":"One Step Closer: Creating the Future to Boost Monocular Semantic Scene Completion","version":1},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-06T16:25:08.062047Z"},"links":{"citing_paper":"/paper/2507.13801"},"observation_digest":"sha256:c476dcdf256cc9188bbec08bad119330382cf0f156e864557bc079a30afe5ffa","observation_id":"1fe07b18-30a1-4d59-b8d1-aa99e7a6a18b","resolution":{"observed_at":"2026-08-06T16:25:09.245246Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T16:25:09.228312Z","title":"Video frame interpolation with transformer,","venue":null,"work_id":"42a75d1c-c2ed-4c19-9e10-8aa41ee0ff51","year":2022},"citing_paper":{"arxiv_id":"2507.13801","last_updated":"2025-07-18T10:24:58Z","snapshot_observed_at":"2026-08-07T21:50:37.650757Z","submitted_at":"2025-07-18T10:24:58Z","title":"One Step Closer: Creating the Future to Boost Monocular Semantic Scene Completion","version":1},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-06T16:25:08.112215Z"},"links":{"citing_paper":"/paper/2507.13801"},"observation_digest":"sha256:8fec61cf1598df3e3ed735f0c9f6a0bc024ca19a0b1a082af038d27660ce3447","observation_id":"390eb626-8262-440b-9e3d-906b64ef1351","resolution":{"observed_at":"2026-08-06T16:25:09.232308Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2203.09303","last_updated":"2022-11-09T10:35:59Z","snapshot_observed_at":"2026-08-08T20:26:28.155086Z","submitted_at":"2022-03-17T13:08:28Z","title":"MSPred: Video Prediction at Multiple Spatio-Temporal Scales with Hierarchical Recurrent Networks","version":4},"cited_work":{"arxiv_id":"2203.09303","doi":null,"metadata_source":"pith","pith_arxiv_id":"2203.09303","snapshot_observed_at":"2026-08-06T16:25:09.002495Z","title":"MSPred: Video Prediction at Multiple Spatio-Temporal Scales with Hierarchical Recurrent Networks","venue":"cs.CV","work_id":"56512a71-e473-4426-9d07-bfd4bcf4247a","year":2022},"citing_paper":{"arxiv_id":"2507.13801","last_updated":"2025-07-18T10:24:58Z","snapshot_observed_at":"2026-08-07T21:50:37.650757Z","submitted_at":"2025-07-18T10:24:58Z","title":"One Step Closer: Creating the Future to Boost Monocular Semantic Scene Completion","version":1},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-08-06T16:25:08.192578Z"},"links":{"cited_paper":"/paper/2203.09303","citing_paper":"/paper/2507.13801"},"observation_digest":"sha256:a1e8fc7c1a63dbe5c0786eb26c9d7997bf85164879af90e28c75edf2a9dc4b34","observation_id":"2d8e3293-e6d5-4f2d-aebb-7bb1c3db90e0","resolution":{"observed_at":"2026-08-06T16:25:09.009113Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T16:25:09.214722Z","title":"Biformer: Learning bilateral motion estimation via bilateral transformer for 4k video frame interpolation,","venue":null,"work_id":"2bdae91b-2b0b-4280-967d-b1c1eda45dfa","year":2023},"citing_paper":{"arxiv_id":"2507.13801","last_updated":"2025-07-18T10:24:58Z","snapshot_observed_at":"2026-08-07T21:50:37.650757Z","submitted_at":"2025-07-18T10:24:58Z","title":"One Step Closer: Creating the Future to Boost Monocular Semantic Scene Completion","version":1},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-08-06T16:25:08.316194Z"},"links":{"citing_paper":"/paper/2507.13801"},"observation_digest":"sha256:f59b781fcf19f3fdeac6755e6f9850e4770ab8599dd0df1f6d6f7628644f6b0d","observation_id":"98e10096-ac9c-4b75-8534-e5bbf8f523e5","resolution":{"observed_at":"2026-08-06T16:25:09.218779Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T16:25:09.201361Z","title":"Stochastic latent residual video prediction,","venue":null,"work_id":"3a868019-813b-4004-aba3-b8a6dc40ff5f","year":2020},"citing_paper":{"arxiv_id":"2507.13801","last_updated":"2025-07-18T10:24:58Z","snapshot_observed_at":"2026-08-07T21:50:37.650757Z","submitted_at":"2025-07-18T10:24:58Z","title":"One Step Closer: Creating the Future to Boost Monocular Semantic Scene Completion","version":1},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-08-06T16:25:08.474135Z"},"links":{"citing_paper":"/paper/2507.13801"},"observation_digest":"sha256:1d82fa1ecf3d783c168237146973c907d73b8c9faf635132587fc6ed3b541c34","observation_id":"81887d27-5aee-4736-a3f9-2c9d57d050bc","resolution":{"observed_at":"2026-08-06T16:25:09.205350Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T16:25:09.187991Z","title":"Greedy hierarchical variational autoencoders for large-scale video predic- tion,","venue":null,"work_id":"e96fcf23-ea86-4b66-9794-b123edb37489","year":2021},"citing_paper":{"arxiv_id":"2507.13801","last_updated":"2025-07-18T10:24:58Z","snapshot_observed_at":"2026-08-07T21:50:37.650757Z","submitted_at":"2025-07-18T10:24:58Z","title":"One Step Closer: Creating the Future to Boost Monocular Semantic Scene Completion","version":1},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-08-06T16:25:08.665012Z"},"links":{"citing_paper":"/paper/2507.13801"},"observation_digest":"sha256:fdae60f4ad651fe1a3211012693e0dda236b0e33735fa8623479c9bf5312c8ff","observation_id":"508fc455-a2b1-435d-8099-4d7cc65b6e5f","resolution":{"observed_at":"2026-08-06T16:25:09.191966Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T16:25:08.723595Z","title":"Denoising diffusion probabilistic models,","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2507.13801","last_updated":"2025-07-18T10:24:58Z","snapshot_observed_at":"2026-08-07T21:50:37.650757Z","submitted_at":"2025-07-18T10:24:58Z","title":"One Step Closer: Creating the Future to Boost Monocular Semantic Scene Completion","version":1},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-08-06T16:25:08.723595Z"},"links":{"citing_paper":"/paper/2507.13801"},"observation_digest":"sha256:0a4177b1da049ff7c35f6457260ab83d73c4c9b0aff0de40822e930a9afb60d1","observation_id":"f2d20e65-af8c-4812-8f0e-78ab6a0534b0","resolution":{"observed_at":"2026-08-06T16:25:08.723595Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T16:25:08.837571Z","title":"High-resolution image synthesis with latent diffusion models,","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2507.13801","last_updated":"2025-07-18T10:24:58Z","snapshot_observed_at":"2026-08-07T21:50:37.650757Z","submitted_at":"2025-07-18T10:24:58Z","title":"One Step Closer: Creating the Future to Boost Monocular Semantic Scene Completion","version":1},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-08-06T16:25:08.837571Z"},"links":{"citing_paper":"/paper/2507.13801"},"observation_digest":"sha256:a35e0bae142073a5479e397524ee7484039b0425ef03a9369f4066c3e52f26ed","observation_id":"835c5feb-9252-4fa7-b0ca-a3cefa28125e","resolution":{"observed_at":"2026-08-06T16:25:08.837571Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T16:25:09.153606Z","title":"Align your latents: High-resolution video synthe- sis with latent diffusion models,","venue":null,"work_id":"d848d3a7-e3e7-4f97-99ec-3b2495633b54","year":2023},"citing_paper":{"arxiv_id":"2507.13801","last_updated":"2025-07-18T10:24:58Z","snapshot_observed_at":"2026-08-07T21:50:37.650757Z","submitted_at":"2025-07-18T10:24:58Z","title":"One Step Closer: Creating the Future to Boost Monocular Semantic Scene Completion","version":1},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-08-06T16:25:08.896916Z"},"links":{"citing_paper":"/paper/2507.13801"},"observation_digest":"sha256:b4e46c645284193060cd64062fc3c731bfbda9410e3f9ce92fe6d4246adcf138","observation_id":"fbeb3f95-6ba7-4166-b779-38ac242142e6","resolution":{"observed_at":"2026-08-06T16:25:09.160622Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T16:25:08.901046Z","title":"Surroundocc: Multi-camera 3d occupancy prediction for autonomous driving,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2507.13801","last_updated":"2025-07-18T10:24:58Z","snapshot_observed_at":"2026-08-07T21:50:37.650757Z","submitted_at":"2025-07-18T10:24:58Z","title":"One Step Closer: Creating the Future to Boost Monocular Semantic Scene Completion","version":1},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-08-06T16:25:08.901046Z"},"links":{"citing_paper":"/paper/2507.13801"},"observation_digest":"sha256:b88d672c8ac4d6185a74e750d5791670cbf42e7c44d22f00fe46c1dbc63fe8f2","observation_id":"c442eb49-fb8c-4e83-a434-78b243bb5416","resolution":{"observed_at":"2026-08-06T16:25:08.901046Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T16:25:09.129040Z","title":"Occformer: Dual-path transformer for vision-based 3d semantic occupancy prediction,","venue":null,"work_id":"bd858bb0-6306-4783-bb73-d673f4481c24","year":2023},"citing_paper":{"arxiv_id":"2507.13801","last_updated":"2025-07-18T10:24:58Z","snapshot_observed_at":"2026-08-07T21:50:37.650757Z","submitted_at":"2025-07-18T10:24:58Z","title":"One Step Closer: Creating the Future to Boost Monocular Semantic Scene Completion","version":1},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-08-06T16:25:08.905520Z"},"links":{"citing_paper":"/paper/2507.13801"},"observation_digest":"sha256:4755013a38c743f76a4509a4f3ebbbbde65a2707a48aaf2f516693ebf29cf0b4","observation_id":"ce253b94-2838-4da4-8cf0-d3defecceb2c","resolution":{"observed_at":"2026-08-06T16:25:09.133305Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T16:25:09.116154Z","title":"Instance-aware monocular 3d semantic scene completion,","venue":null,"work_id":"12667703-13b1-4dde-913a-894577f4083c","year":2024},"citing_paper":{"arxiv_id":"2507.13801","last_updated":"2025-07-18T10:24:58Z","snapshot_observed_at":"2026-08-07T21:50:37.650757Z","submitted_at":"2025-07-18T10:24:58Z","title":"One Step Closer: Creating the Future to Boost Monocular Semantic Scene Completion","version":1},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-08-06T16:25:08.909810Z"},"links":{"citing_paper":"/paper/2507.13801"},"observation_digest":"sha256:c7c79e7bf55a71fe54e8a7f8480f9e3a5450e31fd8fa505ef30f8d36ddb94469","observation_id":"d2314277-fb76-4aa2-b918-1588755c7e63","resolution":{"observed_at":"2026-08-06T16:25:09.120071Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2311.17084","last_updated":"2024-11-25T23:13:35Z","snapshot_observed_at":"2026-07-06T16:53:58.875152Z","submitted_at":"2023-11-28T01:47:51Z","title":"DepthSSC: Monocular 3D Semantic Scene Completion via Depth-Spatial Alignment and Voxel Adaptation","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2311.17084","snapshot_observed_at":"2026-08-06T16:25:08.913706Z","title":"Depthssc: Depth-spatial alignment and dynamic voxel resolution for monocular 3d semantic scene completion,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2507.13801","last_updated":"2025-07-18T10:24:58Z","snapshot_observed_at":"2026-08-07T21:50:37.650757Z","submitted_at":"2025-07-18T10:24:58Z","title":"One Step Closer: Creating the Future to Boost Monocular Semantic Scene Completion","version":1},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-08-06T16:25:08.913706Z"},"links":{"cited_paper":"/paper/2311.17084","citing_paper":"/paper/2507.13801"},"observation_digest":"sha256:e3e254d36425fc336ef554f4262025be96f3d400f42b7d289460ab3943e0a88d","observation_id":"a5cfd230-18bb-4222-97b4-e568103c057f","resolution":{"observed_at":"2026-08-06T16:25:08.913706Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T16:25:09.102802Z","title":"Batch normalization: Accelerating deep network training by reducing internal covariate shift,","venue":null,"work_id":"54cb69bd-65df-4e2e-bdfb-fbffd29790f5","year":2015},"citing_paper":{"arxiv_id":"2507.13801","last_updated":"2025-07-18T10:24:58Z","snapshot_observed_at":"2026-08-07T21:50:37.650757Z","submitted_at":"2025-07-18T10:24:58Z","title":"One Step Closer: Creating the Future to Boost Monocular Semantic Scene Completion","version":1},"reference_index":36,"source":"pdf_text","source_observed_at":"2026-08-06T16:25:08.918292Z"},"links":{"citing_paper":"/paper/2507.13801"},"observation_digest":"sha256:876a5c58cc38e0bea17a0808bb61408b296fc1058221be468f256258d79f110c","observation_id":"e9d93671-cc20-468e-b978-90c5307d3882","resolution":{"observed_at":"2026-08-06T16:25:09.106765Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T16:25:09.089321Z","title":"Arbitrary style transfer in real-time with adaptive instance normalization,","venue":null,"work_id":"e4b1f756-ca48-42d3-9316-ab5da93902f6","year":2017},"citing_paper":{"arxiv_id":"2507.13801","last_updated":"2025-07-18T10:24:58Z","snapshot_observed_at":"2026-08-07T21:50:37.650757Z","submitted_at":"2025-07-18T10:24:58Z","title":"One Step Closer: Creating the Future to Boost Monocular Semantic Scene Completion","version":1},"reference_index":37,"source":"pdf_text","source_observed_at":"2026-08-06T16:25:08.922503Z"},"links":{"citing_paper":"/paper/2507.13801"},"observation_digest":"sha256:af975984097e90166546380beba869a9be8fb19f1bed8875d38b5a165ddfef6b","observation_id":"ebdbca57-617c-4ef2-9a03-83889e5622e2","resolution":{"observed_at":"2026-08-06T16:25:09.093608Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T16:25:09.076242Z","title":"Deepvo: Towards end-to-end visual odometry with deep recurrent convolutional neural networks,","venue":null,"work_id":"cd62919e-44e2-44d1-a139-318d3bc7765d","year":2017},"citing_paper":{"arxiv_id":"2507.13801","last_updated":"2025-07-18T10:24:58Z","snapshot_observed_at":"2026-08-07T21:50:37.650757Z","submitted_at":"2025-07-18T10:24:58Z","title":"One Step Closer: Creating the Future to Boost Monocular Semantic Scene Completion","version":1},"reference_index":38,"source":"pdf_text","source_observed_at":"2026-08-06T16:25:08.926348Z"},"links":{"citing_paper":"/paper/2507.13801"},"observation_digest":"sha256:e16b9965cf768d25f1cbe4ccb9f6a7a7a67c2db8ce36b75380726ea775b2b66b","observation_id":"66e20640-e86b-458d-868a-efbd004766a5","resolution":{"observed_at":"2026-08-06T16:25:09.080246Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1711.05101","last_updated":"2019-01-04T21:01:49Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2017-11-14T14:24:06Z","title":"Decoupled Weight Decay Regularization","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1711.05101","snapshot_observed_at":"2026-08-06T16:25:08.930474Z","title":"Decoupled weight decay regularization,","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2507.13801","last_updated":"2025-07-18T10:24:58Z","snapshot_observed_at":"2026-08-07T21:50:37.650757Z","submitted_at":"2025-07-18T10:24:58Z","title":"One Step Closer: Creating the Future to Boost Monocular Semantic Scene Completion","version":1},"reference_index":39,"source":"pdf_text","source_observed_at":"2026-08-06T16:25:08.930474Z"},"links":{"cited_paper":"/paper/1711.05101","citing_paper":"/paper/2507.13801"},"observation_digest":"sha256:c647a569e62dab21b8433f0b5e883012cba5c875d2b3a092637ed261fb453142","observation_id":"ecfa9947-5e0c-4fba-bec4-e7e99e7f8c02","resolution":{"observed_at":"2026-08-06T16:25:08.930474Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T16:25:08.934868Z","title":"Deep residual learning for image recognition,","venue":null,"work_id":null,"year":2016},"citing_paper":{"arxiv_id":"2507.13801","last_updated":"2025-07-18T10:24:58Z","snapshot_observed_at":"2026-08-07T21:50:37.650757Z","submitted_at":"2025-07-18T10:24:58Z","title":"One Step Closer: Creating the Future to Boost Monocular Semantic Scene Completion","version":1},"reference_index":40,"source":"pdf_text","source_observed_at":"2026-08-06T16:25:08.934868Z"},"links":{"citing_paper":"/paper/2507.13801"},"observation_digest":"sha256:a25d537a5b852c2d3bcd691f5d4b6afb1f987c33981bee1d1d152e850598c48c","observation_id":"dea03f3e-0aec-4853-8f26-4c838700f1b1","resolution":{"observed_at":"2026-08-06T16:25:08.934868Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T16:25:09.054179Z","title":"Mask dino: Towards a unified transformer-based framework for object detection and segmentation,","venue":null,"work_id":"c877d9e9-e563-451c-b21b-f8dbc8e6614f","year":2023},"citing_paper":{"arxiv_id":"2507.13801","last_updated":"2025-07-18T10:24:58Z","snapshot_observed_at":"2026-08-07T21:50:37.650757Z","submitted_at":"2025-07-18T10:24:58Z","title":"One Step Closer: Creating the Future to Boost Monocular Semantic Scene Completion","version":1},"reference_index":41,"source":"pdf_text","source_observed_at":"2026-08-06T16:25:08.938621Z"},"links":{"citing_paper":"/paper/2507.13801"},"observation_digest":"sha256:acd54e7f8c98fb3a61479cb001c97510c1195f1e4286b807a342a2567efac4b4","observation_id":"a990026f-c5b2-4c94-a8a9-c3e0d57925e5","resolution":{"observed_at":"2026-08-06T16:25:09.058392Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}}],"paper":{"arxiv_id":"2507.13801","last_updated":"2025-07-18T10:24:58Z","latest_version":1,"primary_category":"cs.CV","snapshot_observed_at":"2026-08-07T21:50:37.650757Z","submitted_at":"2025-07-18T10:24:58Z","title":"One Step Closer: Creating the Future to Boost Monocular Semantic Scene Completion"},"reference_resolution":{"displayed":41,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":11,"verified_exact":2,"verified_fuzzy":28},"total_outbound_references":41},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"thesis":"As of 9 August 2026, this Paper Citation Record lists 41 of 41 outbound references and 0 inbound Pith citation observations for arXiv:2507.13801."}