{"as_of":"2026-08-14T11:29:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:4a01b19d3cead2743e7e36c451828b54a251ac43a2792e35d6114f719f2cd7d4","coverage":[{"denominator":52,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":52,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-06T18:21:43.120620Z","state":"measured"},{"denominator":52,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":52,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-14T06:32:32.682623+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2507.08555/citation-record","integrity":"/paper/2507.08555/integrity","json":"/paper/2507.08555/citation-record.json","paper":"/paper/2507.08555"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T18:21:50.982826Z","title":"Se- mantickitti: A dataset for semantic scene understanding of lidar sequences","venue":null,"work_id":"ca270d2a-2592-49e5-ad00-361ec3222c2f","year":2019},"citing_paper":{"arxiv_id":"2507.08555","last_updated":"2025-07-11T12:57:14Z","snapshot_observed_at":"2026-08-11T06:18:38.166652Z","submitted_at":"2025-07-11T12:57:14Z","title":"Disentangling Instance and Scene Contexts for 3D Semantic Scene Completion","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-06T18:21:38.744920Z"},"links":{"citing_paper":"/paper/2507.08555"},"observation_digest":"sha256:0f5868caf6aebb1eb828be2bf7d1f44b99805ad358c092fbe14d2220f963789b","observation_id":"73649dd4-2bd2-4c14-95e1-329876e0de47","resolution":{"observed_at":"2026-08-06T18:21:51.097579Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T18:21:50.777321Z","title":"Monoscene: Monoc- ular 3d semantic scene completion","venue":null,"work_id":"cee98297-173a-4ba8-9885-94eec2bb47e8","year":2022},"citing_paper":{"arxiv_id":"2507.08555","last_updated":"2025-07-11T12:57:14Z","snapshot_observed_at":"2026-08-11T06:18:38.166652Z","submitted_at":"2025-07-11T12:57:14Z","title":"Disentangling Instance and Scene Contexts for 3D Semantic Scene Completion","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-06T18:21:38.837013Z"},"links":{"citing_paper":"/paper/2507.08555"},"observation_digest":"sha256:a201f0eddc9595ea2303802d44a143394c08a87b6bb4bcd658982ba270842a3f","observation_id":"236d985a-08b2-470f-8691-fcdcc231c4ec","resolution":{"observed_at":"2026-08-06T18:21:50.839874Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T18:21:50.548191Z","title":"Persformer: 3d lane detection via perspec- tive transformer and the openlane benchmark","venue":null,"work_id":"d5415ebd-eddd-4cd2-8727-fea9649566f3","year":2022},"citing_paper":{"arxiv_id":"2507.08555","last_updated":"2025-07-11T12:57:14Z","snapshot_observed_at":"2026-08-11T06:18:38.166652Z","submitted_at":"2025-07-11T12:57:14Z","title":"Disentangling Instance and Scene Contexts for 3D Semantic Scene Completion","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-06T18:21:38.911582Z"},"links":{"citing_paper":"/paper/2507.08555"},"observation_digest":"sha256:1731318885cd3211088ff03e380a3a139cb8ad6c739faed374fd094c0cb15ebb","observation_id":"0d83f4b2-3af2-4fd5-a1d0-651e5a8e49f3","resolution":{"observed_at":"2026-08-06T18:21:50.641230Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T18:21:50.391879Z","title":"Delving into the trajectory long-tail distribution for muti-object track- ing","venue":null,"work_id":"8537633c-aa85-42c0-837e-1d3890783fba","year":2024},"citing_paper":{"arxiv_id":"2507.08555","last_updated":"2025-07-11T12:57:14Z","snapshot_observed_at":"2026-08-11T06:18:38.166652Z","submitted_at":"2025-07-11T12:57:14Z","title":"Disentangling Instance and Scene Contexts for 3D Semantic Scene Completion","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-06T18:21:39.007894Z"},"links":{"citing_paper":"/paper/2507.08555"},"observation_digest":"sha256:1be3c9b80e9a0a5df5d1088a7703804955cee76973b4c4d9965c618ec25ba2d6","observation_id":"4db73065-77e2-40d6-8c87-404a554b0c38","resolution":{"observed_at":"2026-08-06T18:21:50.469436Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T18:21:39.085861Z","title":"Cross-view referring multi-object tracking","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2507.08555","last_updated":"2025-07-11T12:57:14Z","snapshot_observed_at":"2026-08-11T06:18:38.166652Z","submitted_at":"2025-07-11T12:57:14Z","title":"Disentangling Instance and Scene Contexts for 3D Semantic Scene Completion","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-06T18:21:39.085861Z"},"links":{"citing_paper":"/paper/2507.08555"},"observation_digest":"sha256:81875c8a8b1824ade61c1d8f18200aa4e33656c5092afe4b9934c2e1975e6490","observation_id":"c6a73c0f-53bd-4f87-b3cd-4d1468fb9e31","resolution":{"observed_at":"2026-08-06T18:21:39.085861Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T18:21:50.140597Z","title":"S3cnet: A sparse semantic scene completion net- work for lidar point clouds","venue":null,"work_id":"9a0a9200-de95-44dc-8e7c-66fe72302892","year":2021},"citing_paper":{"arxiv_id":"2507.08555","last_updated":"2025-07-11T12:57:14Z","snapshot_observed_at":"2026-08-11T06:18:38.166652Z","submitted_at":"2025-07-11T12:57:14Z","title":"Disentangling Instance and Scene Contexts for 3D Semantic Scene Completion","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-06T18:21:39.142402Z"},"links":{"citing_paper":"/paper/2507.08555"},"observation_digest":"sha256:d24cc6e56512ce5d81c9cbb987b7cda6ba02b47775fcaf390619f89a3b2dddf6","observation_id":"e110266b-7246-417e-aaad-f5d086a88d23","resolution":{"observed_at":"2026-08-06T18:21:50.241733Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T18:21:49.937561Z","title":"Gitnet: Geometric prior- based transformation for birds-eye-view segmentation","venue":null,"work_id":"fb3bb865-799d-4e86-8f60-24f69ab11bd3","year":2022},"citing_paper":{"arxiv_id":"2507.08555","last_updated":"2025-07-11T12:57:14Z","snapshot_observed_at":"2026-08-11T06:18:38.166652Z","submitted_at":"2025-07-11T12:57:14Z","title":"Disentangling Instance and Scene Contexts for 3D Semantic Scene Completion","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-06T18:21:39.255132Z"},"links":{"citing_paper":"/paper/2507.08555"},"observation_digest":"sha256:eabdf9601a97e425cb767f3d57b53b2d6a45bf39345a0c21216e3499752c17b8","observation_id":"7f6ceb49-1c32-4dee-b767-1b5b1508065f","resolution":{"observed_at":"2026-08-06T18:21:50.021312Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T18:21:49.727400Z","title":"Simple-bev: What really mat- ters for multi-sensor bev perception? In2023 IEEE Inter- national Conference on Robotics and Automation (ICRA), pages 2759–2765","venue":null,"work_id":"649b1e72-a420-4bce-a5c3-c515953bc74b","year":2023},"citing_paper":{"arxiv_id":"2507.08555","last_updated":"2025-07-11T12:57:14Z","snapshot_observed_at":"2026-08-11T06:18:38.166652Z","submitted_at":"2025-07-11T12:57:14Z","title":"Disentangling Instance and Scene Contexts for 3D Semantic Scene Completion","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-06T18:21:39.320271Z"},"links":{"citing_paper":"/paper/2507.08555"},"observation_digest":"sha256:a4cab6c8bc2e17c5572cc8e5889505d8136c053f130b71dd1359eabade656e0d","observation_id":"79543a9f-e338-48b2-8458-e59f4a63ba3c","resolution":{"observed_at":"2026-08-06T18:21:49.821190Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T18:21:39.381989Z","title":"Deep residual learning for image recognition","venue":null,"work_id":null,"year":2016},"citing_paper":{"arxiv_id":"2507.08555","last_updated":"2025-07-11T12:57:14Z","snapshot_observed_at":"2026-08-11T06:18:38.166652Z","submitted_at":"2025-07-11T12:57:14Z","title":"Disentangling Instance and Scene Contexts for 3D Semantic Scene Completion","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-06T18:21:39.381989Z"},"links":{"citing_paper":"/paper/2507.08555"},"observation_digest":"sha256:5cc09f18e4e91709507b534eaad903130269a5fb873920a58cad4f6d29f2d170","observation_id":"4a273735-a217-4e5e-8f0a-bcaaa1c61011","resolution":{"observed_at":"2026-08-06T18:21:39.381989Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2403.02710","last_updated":"2024-03-05T07:01:53Z","snapshot_observed_at":"2026-08-13T04:03:21.003519Z","submitted_at":"2024-03-05T07:01:53Z","title":"FastOcc: Accelerating 3D Occupancy Prediction by Fusing the 2D Bird's-Eye View and Perspective View","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2403.02710","snapshot_observed_at":"2026-08-06T18:21:39.503168Z","title":"Fas- tocc: Accelerating 3d occupancy prediction by fusing the 2d bird’s-eye view and perspective view.arXiv preprint arXiv:2403.02710, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.08555","last_updated":"2025-07-11T12:57:14Z","snapshot_observed_at":"2026-08-11T06:18:38.166652Z","submitted_at":"2025-07-11T12:57:14Z","title":"Disentangling Instance and Scene Contexts for 3D Semantic Scene Completion","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-06T18:21:39.503168Z"},"links":{"cited_paper":"/paper/2403.02710","citing_paper":"/paper/2507.08555"},"observation_digest":"sha256:6b95826c15f099ba85004a5187b1a0b688a503618f6ff854ede8fb71c93f620c","observation_id":"af355905-26f2-4b7c-ae82-9e5d233ad0f5","resolution":{"observed_at":"2026-08-06T18:21:39.503168Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T18:21:49.524774Z","title":"Planning-oriented autonomous driving","venue":null,"work_id":"c7f28d56-8732-4a0b-abee-b97e92555608","year":2023},"citing_paper":{"arxiv_id":"2507.08555","last_updated":"2025-07-11T12:57:14Z","snapshot_observed_at":"2026-08-11T06:18:38.166652Z","submitted_at":"2025-07-11T12:57:14Z","title":"Disentangling Instance and Scene Contexts for 3D Semantic Scene Completion","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-06T18:21:39.558880Z"},"links":{"citing_paper":"/paper/2507.08555"},"observation_digest":"sha256:5f11123c289ad89e7c715667695359505f418a76e5ca7b879ef3161df5232d82","observation_id":"5b58932a-7e1c-424f-8660-7f7fc4bcc025","resolution":{"observed_at":"2026-08-06T18:21:49.627590Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T18:21:39.605909Z","title":"Tri-perspective view for vision- based 3d semantic occupancy prediction","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2507.08555","last_updated":"2025-07-11T12:57:14Z","snapshot_observed_at":"2026-08-11T06:18:38.166652Z","submitted_at":"2025-07-11T12:57:14Z","title":"Disentangling Instance and Scene Contexts for 3D Semantic Scene Completion","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-06T18:21:39.605909Z"},"links":{"citing_paper":"/paper/2507.08555"},"observation_digest":"sha256:30d2e70eef8e3260aa59708add3069e5ec960821a69580dfc19e8f9f79781fb7","observation_id":"65299f62-020f-4c80-98d5-ac0294be2fbd","resolution":{"observed_at":"2026-08-06T18:21:39.605909Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T18:21:49.294150Z","title":"Sym- phonize 3d semantic scene completion with contextual in- stance queries","venue":null,"work_id":"189cc775-3355-4fa1-950d-1693045ac89e","year":2024},"citing_paper":{"arxiv_id":"2507.08555","last_updated":"2025-07-11T12:57:14Z","snapshot_observed_at":"2026-08-11T06:18:38.166652Z","submitted_at":"2025-07-11T12:57:14Z","title":"Disentangling Instance and Scene Contexts for 3D Semantic Scene Completion","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-06T18:21:39.718481Z"},"links":{"citing_paper":"/paper/2507.08555"},"observation_digest":"sha256:fd1e8294886e815c4997a824fb314bc7773a8f35e274d62af0b5249668ef767b","observation_id":"81622963-c5e4-4b29-806a-7823f7b5df7a","resolution":{"observed_at":"2026-08-06T18:21:49.402721Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T18:21:49.101043Z","title":"Polarformer: Multi- camera 3d object detection with polar transformer","venue":null,"work_id":"baec61ea-4237-4699-892a-ae50c4e587f8","year":2023},"citing_paper":{"arxiv_id":"2507.08555","last_updated":"2025-07-11T12:57:14Z","snapshot_observed_at":"2026-08-11T06:18:38.166652Z","submitted_at":"2025-07-11T12:57:14Z","title":"Disentangling Instance and Scene Contexts for 3D Semantic Scene Completion","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-06T18:21:39.836020Z"},"links":{"citing_paper":"/paper/2507.08555"},"observation_digest":"sha256:8858be4927b06d04a798614d3fbf79d22198379e35da38ceea103cf1e64aad87","observation_id":"125a9fe4-aab2-4a85-997a-e0750fb213b7","resolution":{"observed_at":"2026-08-06T18:21:49.205272Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T18:21:48.893714Z","title":"Tod3cap: Towards 3d dense captioning in outdoor scenes","venue":null,"work_id":"bc0eec87-120c-4c5d-b2d8-d4dba027b928","year":2024},"citing_paper":{"arxiv_id":"2507.08555","last_updated":"2025-07-11T12:57:14Z","snapshot_observed_at":"2026-08-11T06:18:38.166652Z","submitted_at":"2025-07-11T12:57:14Z","title":"Disentangling Instance and Scene Contexts for 3D Semantic Scene Completion","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-06T18:21:39.970675Z"},"links":{"citing_paper":"/paper/2507.08555"},"observation_digest":"sha256:c65b0ed6b8a0a3e3f6b050adcd3d337c2ba1d992b8c191cd3a923f0725ad3430","observation_id":"ab138368-9b1c-4d52-bb7a-0a771b3b366b","resolution":{"observed_at":"2026-08-06T18:21:48.979584Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2408.03551","last_updated":"2025-08-14T04:31:02Z","snapshot_observed_at":"2026-08-13T06:47:15.507398Z","submitted_at":"2024-08-07T05:23:52Z","title":"VPOcc: Exploiting Vanishing Point for 3D Semantic Occupancy Prediction","version":2},"cited_work":{"arxiv_id":"2408.03551","doi":null,"metadata_source":"pith","pith_arxiv_id":"2408.03551","snapshot_observed_at":"2026-08-06T18:21:43.474269Z","title":"VPOcc: Exploiting Vanishing Point for 3D Semantic Occupancy Prediction","venue":"cs.CV","work_id":"1cf9d236-486c-4942-8ab0-9839829311dc","year":2024},"citing_paper":{"arxiv_id":"2507.08555","last_updated":"2025-07-11T12:57:14Z","snapshot_observed_at":"2026-08-11T06:18:38.166652Z","submitted_at":"2025-07-11T12:57:14Z","title":"Disentangling Instance and Scene Contexts for 3D Semantic Scene Completion","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-06T18:21:40.049085Z"},"links":{"cited_paper":"/paper/2408.03551","citing_paper":"/paper/2507.08555"},"observation_digest":"sha256:a3ed60f426b35427d7d53fd4ce7eae8331e9974e9bdf549e4d878e9ea5ee075d","observation_id":"64c1e440-944b-441e-8257-4dfacdbca1e1","resolution":{"observed_at":"2026-08-06T18:21:43.568122Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2303.13959","last_updated":"2024-05-06T15:14:22Z","snapshot_observed_at":"2026-08-13T12:17:45.687104Z","submitted_at":"2023-03-24T12:33:44Z","title":"Bridging Stereo Geometry and BEV Representation with Reliable Mutual Interaction for Semantic Scene Completion","version":6},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2303.13959","snapshot_observed_at":"2026-08-06T18:21:40.127356Z","title":"Stereoscene: Bev-assisted stereo match- ing empowers 3d semantic scene completion.arXiv preprint arXiv:2303.13959, 1(3):6, 2023","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2507.08555","last_updated":"2025-07-11T12:57:14Z","snapshot_observed_at":"2026-08-11T06:18:38.166652Z","submitted_at":"2025-07-11T12:57:14Z","title":"Disentangling Instance and Scene Contexts for 3D Semantic Scene Completion","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-06T18:21:40.127356Z"},"links":{"cited_paper":"/paper/2303.13959","citing_paper":"/paper/2507.08555"},"observation_digest":"sha256:d41927441e05a253af21000e4ae87a33e6587451b52124581fd897d4585f199d","observation_id":"581c74d2-9f70-47a1-845b-a0f41c1c1e51","resolution":{"observed_at":"2026-08-06T18:21:40.127356Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T18:21:48.702947Z","title":"Hierarchical temporal context learning for camera-based semantic scene comple- tion","venue":null,"work_id":"0e2139ed-8485-4146-8f47-1a8d02e8f5ca","year":2025},"citing_paper":{"arxiv_id":"2507.08555","last_updated":"2025-07-11T12:57:14Z","snapshot_observed_at":"2026-08-11T06:18:38.166652Z","submitted_at":"2025-07-11T12:57:14Z","title":"Disentangling Instance and Scene Contexts for 3D Semantic Scene Completion","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-06T18:21:40.186666Z"},"links":{"citing_paper":"/paper/2507.08555"},"observation_digest":"sha256:626233596e96ad69af163dac0e73d37730eff4584a640e53897a5aa80a773e42","observation_id":"973f485c-3f4a-4b1f-b8f2-2897b5032949","resolution":{"observed_at":"2026-08-06T18:21:48.793217Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T18:21:48.551101Z","title":"Mask dino: Towards a unified transformer-based framework for object detection and segmentation","venue":null,"work_id":"90c676c2-38ca-4fbf-a3a7-f3b6860a6fda","year":2023},"citing_paper":{"arxiv_id":"2507.08555","last_updated":"2025-07-11T12:57:14Z","snapshot_observed_at":"2026-08-11T06:18:38.166652Z","submitted_at":"2025-07-11T12:57:14Z","title":"Disentangling Instance and Scene Contexts for 3D Semantic Scene Completion","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-06T18:21:40.306381Z"},"links":{"citing_paper":"/paper/2507.08555"},"observation_digest":"sha256:c4de05b1c510522deff81fb11c1677fcdf4ca1d8c805f2c3a3a54e0672681d4b","observation_id":"41d440ea-42e8-4c08-80d1-b094e1914949","resolution":{"observed_at":"2026-08-06T18:21:48.636845Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T18:21:48.417042Z","title":"Delving into the devils of bird’s- eye-view perception: A review, evaluation and recipe.IEEE Transactions on Pattern Analysis and Machine Intelligence, 2023","venue":null,"work_id":"11b2d856-c4c5-41e8-aff2-e0f30da6c807","year":2023},"citing_paper":{"arxiv_id":"2507.08555","last_updated":"2025-07-11T12:57:14Z","snapshot_observed_at":"2026-08-11T06:18:38.166652Z","submitted_at":"2025-07-11T12:57:14Z","title":"Disentangling Instance and Scene Contexts for 3D Semantic Scene Completion","version":1},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-06T18:21:40.376290Z"},"links":{"citing_paper":"/paper/2507.08555"},"observation_digest":"sha256:3e45e7275dfd5393aca481720393fb6ca5ba42db876af5a03133aa91c91b1933","observation_id":"8aa57a2c-08ba-45a4-accd-3c85b5594102","resolution":{"observed_at":"2026-08-06T18:21:48.465746Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T18:21:48.185243Z","title":"Ovtr: End-to-end open-vocabulary multiple object tracking with transformer","venue":null,"work_id":"e79c82d7-ef27-418a-9491-4066f5b53344","year":null},"citing_paper":{"arxiv_id":"2507.08555","last_updated":"2025-07-11T12:57:14Z","snapshot_observed_at":"2026-08-11T06:18:38.166652Z","submitted_at":"2025-07-11T12:57:14Z","title":"Disentangling Instance and Scene Contexts for 3D Semantic Scene Completion","version":1},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-06T18:21:40.438470Z"},"links":{"citing_paper":"/paper/2507.08555"},"observation_digest":"sha256:11a56bb0ced2cb54622902ba2fdb2ceb968b9787f591222911edf4a61968b144","observation_id":"f6361db9-cb64-49bd-a5db-cd608176d4db","resolution":{"observed_at":"2026-08-06T18:21:48.304165Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T18:21:48.009892Z","title":"Bevstereo: Enhancing depth estimation in multi-view 3d object detection with temporal stereo","venue":null,"work_id":"c62f099a-b601-46b4-a776-176f223b7372","year":2023},"citing_paper":{"arxiv_id":"2507.08555","last_updated":"2025-07-11T12:57:14Z","snapshot_observed_at":"2026-08-11T06:18:38.166652Z","submitted_at":"2025-07-11T12:57:14Z","title":"Disentangling Instance and Scene Contexts for 3D Semantic Scene Completion","version":1},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-06T18:21:40.481808Z"},"links":{"citing_paper":"/paper/2507.08555"},"observation_digest":"sha256:24c94795e5f12698cbfbd38a8b666ea55638d40d2dce3e01073745ad2fa78158","observation_id":"59fb464f-aa4c-4f2f-9932-e2dfde6f8c23","resolution":{"observed_at":"2026-08-06T18:21:48.085135Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T18:21:47.871679Z","title":"Bevdepth: Acquisition of reliable depth for multi-view 3d object detec- tion","venue":null,"work_id":"6d11850b-6eb3-48de-8ce7-921d56d1a9f5","year":2023},"citing_paper":{"arxiv_id":"2507.08555","last_updated":"2025-07-11T12:57:14Z","snapshot_observed_at":"2026-08-11T06:18:38.166652Z","submitted_at":"2025-07-11T12:57:14Z","title":"Disentangling Instance and Scene Contexts for 3D Semantic Scene Completion","version":1},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-06T18:21:40.553852Z"},"links":{"citing_paper":"/paper/2507.08555"},"observation_digest":"sha256:0ffcfa3296e2e262feda33f5640fe6627f07bfc5789c5aaf2efba867acb55d79","observation_id":"198a884f-3a65-4de8-be0e-50b50dabd0a4","resolution":{"observed_at":"2026-08-06T18:21:47.946382Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2306.09001","last_updated":"2024-09-30T13:27:59Z","snapshot_observed_at":"2026-08-13T11:16:51.006738Z","submitted_at":"2023-06-15T09:56:33Z","title":"SSCBench: A Large-Scale 3D Semantic Scene Completion Benchmark for Autonomous Driving","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2306.09001","snapshot_observed_at":"2026-08-06T18:21:40.623095Z","title":"Sscbench: A large-scale 3d semantic scene com- pletion benchmark for autonomous driving.arXiv preprint arXiv:2306.09001, 2023","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2507.08555","last_updated":"2025-07-11T12:57:14Z","snapshot_observed_at":"2026-08-11T06:18:38.166652Z","submitted_at":"2025-07-11T12:57:14Z","title":"Disentangling Instance and Scene Contexts for 3D Semantic Scene Completion","version":1},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-06T18:21:40.623095Z"},"links":{"cited_paper":"/paper/2306.09001","citing_paper":"/paper/2507.08555"},"observation_digest":"sha256:89fe98ca281650f76862d94be731f04c89a673f9fa8290256e4c9a48adf8bf98","observation_id":"139967ae-2f61-4837-9cb7-68083d59cc62","resolution":{"observed_at":"2026-08-06T18:21:40.623095Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T18:21:47.687037Z","title":"V oxformer: Sparse voxel transformer for camera- based 3d semantic scene completion","venue":null,"work_id":"12ac9672-4741-4062-baf1-98fa0d18e723","year":2023},"citing_paper":{"arxiv_id":"2507.08555","last_updated":"2025-07-11T12:57:14Z","snapshot_observed_at":"2026-08-11T06:18:38.166652Z","submitted_at":"2025-07-11T12:57:14Z","title":"Disentangling Instance and Scene Contexts for 3D Semantic Scene Completion","version":1},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-08-06T18:21:40.709560Z"},"links":{"citing_paper":"/paper/2507.08555"},"observation_digest":"sha256:5f73b75f892dbc0e0c24dbfd06c83df7777585f75a7b718cae816a7386f1b1b8","observation_id":"5dedb99d-0934-4606-a920-8f55660843ab","resolution":{"observed_at":"2026-08-06T18:21:47.777005Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T18:21:47.525203Z","title":"Bevformer: Learning bird’s-eye-view representation from multi-camera images via spatiotemporal transformers","venue":null,"work_id":"8e685db0-abee-47f2-99a7-0c9eb665f0cd","year":2022},"citing_paper":{"arxiv_id":"2507.08555","last_updated":"2025-07-11T12:57:14Z","snapshot_observed_at":"2026-08-11T06:18:38.166652Z","submitted_at":"2025-07-11T12:57:14Z","title":"Disentangling Instance and Scene Contexts for 3D Semantic Scene Completion","version":1},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-08-06T18:21:40.803191Z"},"links":{"citing_paper":"/paper/2507.08555"},"observation_digest":"sha256:0413b42937f1000891ba0b17fdb72333ff9a68fb60daac0d59c0b33519fe8359","observation_id":"f532b265-c827-4825-b9f2-4553471cb3e6","resolution":{"observed_at":"2026-08-06T18:21:47.599985Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1711.05101","last_updated":"2019-01-04T21:01:49Z","snapshot_observed_at":"2026-08-09T20:34:52.923500Z","submitted_at":"2017-11-14T14:24:06Z","title":"Decoupled Weight Decay Regularization","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1711.05101","snapshot_observed_at":"2026-08-06T18:21:40.869417Z","title":"Decoupled weight decay regularization.arXiv preprint arXiv:1711.05101, 2017","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2507.08555","last_updated":"2025-07-11T12:57:14Z","snapshot_observed_at":"2026-08-11T06:18:38.166652Z","submitted_at":"2025-07-11T12:57:14Z","title":"Disentangling Instance and Scene Contexts for 3D Semantic Scene Completion","version":1},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-08-06T18:21:40.869417Z"},"links":{"cited_paper":"/paper/1711.05101","citing_paper":"/paper/2507.08555"},"observation_digest":"sha256:0fb7b6193c7f7e4d38a4dd23f78d3df28a02d62b87fa7b87646b2ba72f8f30fe","observation_id":"108e2644-f07f-4b56-aed6-24c0cfeff466","resolution":{"observed_at":"2026-08-06T18:21:40.869417Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2302.13540","last_updated":"2023-02-27T06:35:03Z","snapshot_observed_at":"2026-08-13T12:37:07.297804Z","submitted_at":"2023-02-27T06:35:03Z","title":"OccDepth: A Depth-Aware Method for 3D Semantic Scene Completion","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2302.13540","snapshot_observed_at":"2026-08-06T18:21:40.991157Z","title":"Occdepth: A depth-aware method for 3d semantic scene completion","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2507.08555","last_updated":"2025-07-11T12:57:14Z","snapshot_observed_at":"2026-08-11T06:18:38.166652Z","submitted_at":"2025-07-11T12:57:14Z","title":"Disentangling Instance and Scene Contexts for 3D Semantic Scene Completion","version":1},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-08-06T18:21:40.991157Z"},"links":{"cited_paper":"/paper/2302.13540","citing_paper":"/paper/2507.08555"},"observation_digest":"sha256:2006e0cbe4013897c5a93bad97b97c3431784b23c3835908d45b59bb381028d6","observation_id":"a33baebd-8156-4f1e-ab99-3e25a466b3a9","resolution":{"observed_at":"2026-08-06T18:21:40.991157Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T18:21:47.305651Z","title":"Lift, splat, shoot: Encoding images from arbitrary camera rigs by implicitly unproject- ing to 3d","venue":null,"work_id":"b9ef1b66-ea17-4d2d-9fd6-cc05b18c8f0c","year":2020},"citing_paper":{"arxiv_id":"2507.08555","last_updated":"2025-07-11T12:57:14Z","snapshot_observed_at":"2026-08-11T06:18:38.166652Z","submitted_at":"2025-07-11T12:57:14Z","title":"Disentangling Instance and Scene Contexts for 3D Semantic Scene Completion","version":1},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-08-06T18:21:41.056542Z"},"links":{"citing_paper":"/paper/2507.08555"},"observation_digest":"sha256:1359be17cfb583e6a9926247b7f532402b6c255fb20f853eb7ff0311d7a165b2","observation_id":"28537db5-3a73-43dd-b3f3-ddfdb0e63dee","resolution":{"observed_at":"2026-08-06T18:21:47.427855Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T18:21:47.142880Z","title":"Categorical depth distribution network for monocular 3d object detection","venue":null,"work_id":"8533cf63-61e5-4622-9104-9de567cb4c7c","year":2021},"citing_paper":{"arxiv_id":"2507.08555","last_updated":"2025-07-11T12:57:14Z","snapshot_observed_at":"2026-08-11T06:18:38.166652Z","submitted_at":"2025-07-11T12:57:14Z","title":"Disentangling Instance and Scene Contexts for 3D Semantic Scene Completion","version":1},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-08-06T18:21:41.160432Z"},"links":{"citing_paper":"/paper/2507.08555"},"observation_digest":"sha256:d405b2fd75c016fc115f8526fbc9d9b70b24901fa6cc95143c9ea5e5fe996ed1","observation_id":"f3b31132-5989-4f3d-a8b8-41eda2e3dcdc","resolution":{"observed_at":"2026-08-06T18:21:47.198667Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T18:21:46.961820Z","title":"Lmscnet: Lightweight multiscale 3d semantic completion","venue":null,"work_id":"ebe8c706-316e-4335-86de-c5e7a2a80ce0","year":2020},"citing_paper":{"arxiv_id":"2507.08555","last_updated":"2025-07-11T12:57:14Z","snapshot_observed_at":"2026-08-11T06:18:38.166652Z","submitted_at":"2025-07-11T12:57:14Z","title":"Disentangling Instance and Scene Contexts for 3D Semantic Scene Completion","version":1},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-08-06T18:21:41.236522Z"},"links":{"citing_paper":"/paper/2507.08555"},"observation_digest":"sha256:11a9be73630388d9f68ca63272857f3fbd7beab2606fe13f2e4f018edc56b2ed","observation_id":"00a57d22-463f-44c6-93a5-abea013f55a4","resolution":{"observed_at":"2026-08-06T18:21:47.045968Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T18:21:46.740464Z","title":"U- net: Convolutional networks for biomedical image segmen- tation","venue":null,"work_id":"86da503c-c22b-4024-9c43-f2a189a9716a","year":2015},"citing_paper":{"arxiv_id":"2507.08555","last_updated":"2025-07-11T12:57:14Z","snapshot_observed_at":"2026-08-11T06:18:38.166652Z","submitted_at":"2025-07-11T12:57:14Z","title":"Disentangling Instance and Scene Contexts for 3D Semantic Scene Completion","version":1},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-08-06T18:21:41.316251Z"},"links":{"citing_paper":"/paper/2507.08555"},"observation_digest":"sha256:84cfb51eb1f9d2956cf217dd67b8c0cc39aa03c4a6a8f48be30c01bbf2cd3ce7","observation_id":"a948feb3-e0ed-4293-8915-2c1ea89da643","resolution":{"observed_at":"2026-08-06T18:21:46.829686Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T18:21:46.462500Z","title":"Focal loss for dense ob- ject detection","venue":null,"work_id":"6a02a115-5669-4999-a61a-5896ee3ca948","year":2017},"citing_paper":{"arxiv_id":"2507.08555","last_updated":"2025-07-11T12:57:14Z","snapshot_observed_at":"2026-08-11T06:18:38.166652Z","submitted_at":"2025-07-11T12:57:14Z","title":"Disentangling Instance and Scene Contexts for 3D Semantic Scene Completion","version":1},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-08-06T18:21:41.458616Z"},"links":{"citing_paper":"/paper/2507.08555"},"observation_digest":"sha256:ee0679a8945e35ac68297da8cea265897ed199cb76663a8d5694c9b0b415d444","observation_id":"50132c13-adf3-4836-8bee-c2518ad441e0","resolution":{"observed_at":"2026-08-06T18:21:46.602722Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T18:21:46.216886Z","title":"Translating images into maps","venue":null,"work_id":"82503f42-94f5-4319-a920-6740a9bbce17","year":2022},"citing_paper":{"arxiv_id":"2507.08555","last_updated":"2025-07-11T12:57:14Z","snapshot_observed_at":"2026-08-11T06:18:38.166652Z","submitted_at":"2025-07-11T12:57:14Z","title":"Disentangling Instance and Scene Contexts for 3D Semantic Scene Completion","version":1},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-08-06T18:21:41.536517Z"},"links":{"citing_paper":"/paper/2507.08555"},"observation_digest":"sha256:d27c3d1bbf76738189401526782a26f4a87a5c92cb0b50f9aeb5ee4f870af8fd","observation_id":"3c949ebf-a68a-40f1-8ddf-4abd6cf38d12","resolution":{"observed_at":"2026-08-06T18:21:46.304676Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T18:21:46.049713Z","title":"Mobilestereonet: Towards lightweight deep net- works for stereo matching","venue":null,"work_id":"4e690248-fcaf-437a-a6a7-10d98407e947","year":2022},"citing_paper":{"arxiv_id":"2507.08555","last_updated":"2025-07-11T12:57:14Z","snapshot_observed_at":"2026-08-11T06:18:38.166652Z","submitted_at":"2025-07-11T12:57:14Z","title":"Disentangling Instance and Scene Contexts for 3D Semantic Scene Completion","version":1},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-08-06T18:21:41.614326Z"},"links":{"citing_paper":"/paper/2507.08555"},"observation_digest":"sha256:06c3273272c36f7331f28b4ced9e6f5dce804a9636f572c335484914925e6f01","observation_id":"ea497db7-b2df-4306-a306-6efa23cfd2e0","resolution":{"observed_at":"2026-08-06T18:21:46.148876Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T18:21:45.863910Z","title":"Semantic scene com- pletion from a single depth image","venue":null,"work_id":"d3707b96-9016-40cc-898e-95c55d258024","year":2017},"citing_paper":{"arxiv_id":"2507.08555","last_updated":"2025-07-11T12:57:14Z","snapshot_observed_at":"2026-08-11T06:18:38.166652Z","submitted_at":"2025-07-11T12:57:14Z","title":"Disentangling Instance and Scene Contexts for 3D Semantic Scene Completion","version":1},"reference_index":36,"source":"pdf_text","source_observed_at":"2026-08-06T18:21:41.681313Z"},"links":{"citing_paper":"/paper/2507.08555"},"observation_digest":"sha256:55a84c5d521f40ad1db831b2e32566c235b6d0b3d7adaba71ef60c1962658c20","observation_id":"cf3967ed-d107-430d-a447-8bebbd0d7669","resolution":{"observed_at":"2026-08-06T18:21:45.930459Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T18:21:45.630060Z","title":"Occ3d: A large-scale 3d occupancy prediction benchmark for autonomous driving.Advances in Neural Information Processing Systems, 36:64318–64330, 2023","venue":null,"work_id":"1c9a15cd-a8bc-44fe-8773-c76fdf4c0ebf","year":2023},"citing_paper":{"arxiv_id":"2507.08555","last_updated":"2025-07-11T12:57:14Z","snapshot_observed_at":"2026-08-11T06:18:38.166652Z","submitted_at":"2025-07-11T12:57:14Z","title":"Disentangling Instance and Scene Contexts for 3D Semantic Scene Completion","version":1},"reference_index":37,"source":"pdf_text","source_observed_at":"2026-08-06T18:21:41.753203Z"},"links":{"citing_paper":"/paper/2507.08555"},"observation_digest":"sha256:fd9105257d4111b938d0f7a118cb8a8b489d6901fd9ad917a0c5834a543de330","observation_id":"a6434ba4-6f92-460b-bdb7-72952afbff24","resolution":{"observed_at":"2026-08-06T18:21:45.781554Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T18:21:45.429101Z","title":"Not all voxels are equal: Hardness-aware semantic scene completion with self- distillation","venue":null,"work_id":"30078f0a-3651-48a9-a29a-cf75071f09d2","year":2024},"citing_paper":{"arxiv_id":"2507.08555","last_updated":"2025-07-11T12:57:14Z","snapshot_observed_at":"2026-08-11T06:18:38.166652Z","submitted_at":"2025-07-11T12:57:14Z","title":"Disentangling Instance and Scene Contexts for 3D Semantic Scene Completion","version":1},"reference_index":39,"source":"pdf_text","source_observed_at":"2026-08-06T18:21:41.917891Z"},"links":{"citing_paper":"/paper/2507.08555"},"observation_digest":"sha256:c28e44f71a46f0ca99508fc231ee59ad6856a1ab9739452f1b778b6dca27a42a","observation_id":"717820dd-1e35-4d03-b3d6-af1d0cb366ac","resolution":{"observed_at":"2026-08-06T18:21:45.512085Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T18:21:45.310359Z","title":"Bevspread: Spread voxel pooling for bird’s-eye- view representation in vision-based roadside 3d object detec- tion","venue":null,"work_id":"ddadb863-d3b0-45e0-97d5-e9344ba24270","year":2024},"citing_paper":{"arxiv_id":"2507.08555","last_updated":"2025-07-11T12:57:14Z","snapshot_observed_at":"2026-08-11T06:18:38.166652Z","submitted_at":"2025-07-11T12:57:14Z","title":"Disentangling Instance and Scene Contexts for 3D Semantic Scene Completion","version":1},"reference_index":40,"source":"pdf_text","source_observed_at":"2026-08-06T18:21:42.003041Z"},"links":{"citing_paper":"/paper/2507.08555"},"observation_digest":"sha256:54a0f97e385556bcf3700e77ab523c1bdce40b672e5c8eb64a22258f073ed1a5","observation_id":"99b6ea6d-1d9d-4551-a39a-c530e116bc02","resolution":{"observed_at":"2026-08-06T18:21:45.356864Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T18:21:45.131803Z","title":"H2gformer: Horizontal-to-global voxel transformer for 3d semantic scene completion","venue":null,"work_id":"5f6e7ec8-94a4-4430-80a3-b75a85fe3d6b","year":2024},"citing_paper":{"arxiv_id":"2507.08555","last_updated":"2025-07-11T12:57:14Z","snapshot_observed_at":"2026-08-11T06:18:38.166652Z","submitted_at":"2025-07-11T12:57:14Z","title":"Disentangling Instance and Scene Contexts for 3D Semantic Scene Completion","version":1},"reference_index":41,"source":"pdf_text","source_observed_at":"2026-08-06T18:21:42.074263Z"},"links":{"citing_paper":"/paper/2507.08555"},"observation_digest":"sha256:d8ef730a5509a86989e0f9c175c9c24241194549343952bc82238cf58aabefea","observation_id":"8f51239d-dc5f-4741-bf3c-343586131fee","resolution":{"observed_at":"2026-08-06T18:21:45.190995Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T18:21:44.985998Z","title":"Surroundocc: Multi-camera 3d occu- pancy prediction for autonomous driving","venue":null,"work_id":"80dd7fe5-87c8-4abb-acdb-636723056cfa","year":2023},"citing_paper":{"arxiv_id":"2507.08555","last_updated":"2025-07-11T12:57:14Z","snapshot_observed_at":"2026-08-11T06:18:38.166652Z","submitted_at":"2025-07-11T12:57:14Z","title":"Disentangling Instance and Scene Contexts for 3D Semantic Scene Completion","version":1},"reference_index":42,"source":"pdf_text","source_observed_at":"2026-08-06T18:21:42.149160Z"},"links":{"citing_paper":"/paper/2507.08555"},"observation_digest":"sha256:405c5d2ff8c0ff7098c6f18f9c94d2d780b3b2e3cdd2a8722f49df3c32ae983a","observation_id":"0e4d6694-6e82-4864-870b-c3a089bd2b93","resolution":{"observed_at":"2026-08-06T18:21:45.055749Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T18:21:44.827334Z","title":"Instance-aware monocular 3d semantic scene comple- tion.IEEE Transactions on Intelligent Transportation Sys- tems, 2024","venue":null,"work_id":"c1fb1c90-06fd-4c64-9121-bc2bf675801d","year":2024},"citing_paper":{"arxiv_id":"2507.08555","last_updated":"2025-07-11T12:57:14Z","snapshot_observed_at":"2026-08-11T06:18:38.166652Z","submitted_at":"2025-07-11T12:57:14Z","title":"Disentangling Instance and Scene Contexts for 3D Semantic Scene Completion","version":1},"reference_index":43,"source":"pdf_text","source_observed_at":"2026-08-06T18:21:42.199888Z"},"links":{"citing_paper":"/paper/2507.08555"},"observation_digest":"sha256:1444afe2e84ccfd8197df618020ed0929ddde372455dab5b95d7ed571f878853","observation_id":"7a530b40-ed71-45e5-b268-fbf79d203609","resolution":{"observed_at":"2026-08-06T18:21:44.899562Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2207.02202","last_updated":"2022-09-25T07:19:32Z","snapshot_observed_at":"2026-08-13T15:10:07.545432Z","submitted_at":"2022-07-05T17:59:28Z","title":"CoBEVT: Cooperative Bird's Eye View Semantic Segmentation with Sparse Transformers","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2207.02202","snapshot_observed_at":"2026-08-06T18:21:42.294141Z","title":"Cobevt: Cooperative bird’s eye view semantic segmentation with sparse transformers.arXiv preprint arXiv:2207.02202, 2022","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2507.08555","last_updated":"2025-07-11T12:57:14Z","snapshot_observed_at":"2026-08-11T06:18:38.166652Z","submitted_at":"2025-07-11T12:57:14Z","title":"Disentangling Instance and Scene Contexts for 3D Semantic Scene Completion","version":1},"reference_index":44,"source":"pdf_text","source_observed_at":"2026-08-06T18:21:42.294141Z"},"links":{"cited_paper":"/paper/2207.02202","citing_paper":"/paper/2507.08555"},"observation_digest":"sha256:46556710f1057ced6cc22bcf2aad5d8cfc614837a9ce3a8fdf234b221ed8afd8","observation_id":"ea5cd2da-95c5-4d6b-8dcf-5b2f6596248f","resolution":{"observed_at":"2026-08-06T18:21:42.294141Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T18:21:44.636136Z","title":"Sparse single sweep lidar point cloud segmentation via learning contextual shape priors from scene completion","venue":null,"work_id":"6d22d700-77ff-4e6f-88e4-1e2d2915bf77","year":2021},"citing_paper":{"arxiv_id":"2507.08555","last_updated":"2025-07-11T12:57:14Z","snapshot_observed_at":"2026-08-11T06:18:38.166652Z","submitted_at":"2025-07-11T12:57:14Z","title":"Disentangling Instance and Scene Contexts for 3D Semantic Scene Completion","version":1},"reference_index":45,"source":"pdf_text","source_observed_at":"2026-08-06T18:21:42.400518Z"},"links":{"citing_paper":"/paper/2507.08555"},"observation_digest":"sha256:2d688f4afac0f6687bedf9e5a3fb56e3207fcd04b728958117790f49db8893f8","observation_id":"8b16e03d-37b3-4970-b617-3454201319e3","resolution":{"observed_at":"2026-08-06T18:21:44.705812Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2311.17084","last_updated":"2024-11-25T23:13:35Z","snapshot_observed_at":"2026-08-13T05:15:50.556867Z","submitted_at":"2023-11-28T01:47:51Z","title":"DepthSSC: Monocular 3D Semantic Scene Completion via Depth-Spatial Alignment and Voxel Adaptation","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2311.17084","snapshot_observed_at":"2026-08-06T18:21:42.471492Z","title":"Depthssc: Depth- spatial alignment and dynamic voxel resolution for monoc- ular 3d semantic scene completion.arXiv preprint arXiv:2311.17084, 2023","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2507.08555","last_updated":"2025-07-11T12:57:14Z","snapshot_observed_at":"2026-08-11T06:18:38.166652Z","submitted_at":"2025-07-11T12:57:14Z","title":"Disentangling Instance and Scene Contexts for 3D Semantic Scene Completion","version":1},"reference_index":46,"source":"pdf_text","source_observed_at":"2026-08-06T18:21:42.471492Z"},"links":{"cited_paper":"/paper/2311.17084","citing_paper":"/paper/2507.08555"},"observation_digest":"sha256:150277fe273ba0d0128486ce3f30a0ff5a6ed7ea0015d840b683e4de64145a04","observation_id":"03c20fe1-3f9d-452e-9066-e13d7fa3b603","resolution":{"observed_at":"2026-08-06T18:21:42.471492Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2305.14298","last_updated":"2023-05-23T17:40:13Z","snapshot_observed_at":"2026-08-13T11:35:18.170952Z","submitted_at":"2023-05-23T17:40:13Z","title":"MOTRv3: Release-Fetch Supervision for End-to-End Multi-Object Tracking","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2305.14298","snapshot_observed_at":"2026-08-06T18:21:42.533311Z","title":"Motrv3: Release-fetch super- vision for end-to-end multi-object tracking.arXiv preprint arXiv:2305.14298, 2023","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2507.08555","last_updated":"2025-07-11T12:57:14Z","snapshot_observed_at":"2026-08-11T06:18:38.166652Z","submitted_at":"2025-07-11T12:57:14Z","title":"Disentangling Instance and Scene Contexts for 3D Semantic Scene Completion","version":1},"reference_index":47,"source":"pdf_text","source_observed_at":"2026-08-06T18:21:42.533311Z"},"links":{"cited_paper":"/paper/2305.14298","citing_paper":"/paper/2507.08555"},"observation_digest":"sha256:7f48f33d2c34b6384da288c1d11db588727b882266e9d89a03818d8ef615b848","observation_id":"7ce891ac-417f-402a-885a-c5eeb5481b72","resolution":{"observed_at":"2026-08-06T18:21:42.533311Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T18:21:44.490289Z","title":"Merlin: Empowering multimodal llms with foresight minds","venue":null,"work_id":"12d3a2cb-85db-47b5-a314-edfabc11c592","year":2024},"citing_paper":{"arxiv_id":"2507.08555","last_updated":"2025-07-11T12:57:14Z","snapshot_observed_at":"2026-08-11T06:18:38.166652Z","submitted_at":"2025-07-11T12:57:14Z","title":"Disentangling Instance and Scene Contexts for 3D Semantic Scene Completion","version":1},"reference_index":48,"source":"pdf_text","source_observed_at":"2026-08-06T18:21:42.631558Z"},"links":{"citing_paper":"/paper/2507.08555"},"observation_digest":"sha256:68bd5ba0ada4b20777592000bb37489f15a0dbf745a52e1b1032b06aea3316e3","observation_id":"75b4ab9f-8fec-4f41-b013-356c4c270eb9","resolution":{"observed_at":"2026-08-06T18:21:44.549283Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2311.12058","last_updated":"2023-11-18T15:28:09Z","snapshot_observed_at":"2026-08-13T05:22:39.884966Z","submitted_at":"2023-11-18T15:28:09Z","title":"FlashOcc: Fast and Memory-Efficient Occupancy Prediction via Channel-to-Height Plugin","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2311.12058","snapshot_observed_at":"2026-08-06T18:21:42.767511Z","title":"Flashocc: Fast and memory-efficient occupancy prediction via channel-to-height plugin.arXiv preprint arXiv:2311.12058, 2023","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2507.08555","last_updated":"2025-07-11T12:57:14Z","snapshot_observed_at":"2026-08-11T06:18:38.166652Z","submitted_at":"2025-07-11T12:57:14Z","title":"Disentangling Instance and Scene Contexts for 3D Semantic Scene Completion","version":1},"reference_index":49,"source":"pdf_text","source_observed_at":"2026-08-06T18:21:42.767511Z"},"links":{"cited_paper":"/paper/2311.12058","citing_paper":"/paper/2507.08555"},"observation_digest":"sha256:30be3b19aec23ffb84a3b22cc2df5c9583470c00660763919eb91e842abdb059","observation_id":"0facdfd7-ec01-4650-b085-30fed99edf7d","resolution":{"observed_at":"2026-08-06T18:21:42.767511Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T18:21:44.235232Z","title":"Context and geometry aware voxel transformer for semantic scene completion","venue":null,"work_id":"4695b510-f1c5-4c66-a540-16b6b4e0b178","year":2024},"citing_paper":{"arxiv_id":"2507.08555","last_updated":"2025-07-11T12:57:14Z","snapshot_observed_at":"2026-08-11T06:18:38.166652Z","submitted_at":"2025-07-11T12:57:14Z","title":"Disentangling Instance and Scene Contexts for 3D Semantic Scene Completion","version":1},"reference_index":50,"source":"pdf_text","source_observed_at":"2026-08-06T18:21:42.870402Z"},"links":{"citing_paper":"/paper/2507.08555"},"observation_digest":"sha256:3f874e4cdba7629d9cc52764d46462d06556a5bd2d371390d10a5953e7621895","observation_id":"8b4a0e83-b409-472f-89da-dabbb8f26a1e","resolution":{"observed_at":"2026-08-06T18:21:44.390163Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T18:21:44.060872Z","title":"Sa-bev: Generating semantic-aware bird’s-eye-view feature for multi-view 3d object detection","venue":null,"work_id":"89947a0a-387a-4130-bf1d-1ce31e5482a9","year":2023},"citing_paper":{"arxiv_id":"2507.08555","last_updated":"2025-07-11T12:57:14Z","snapshot_observed_at":"2026-08-11T06:18:38.166652Z","submitted_at":"2025-07-11T12:57:14Z","title":"Disentangling Instance and Scene Contexts for 3D Semantic Scene Completion","version":1},"reference_index":51,"source":"pdf_text","source_observed_at":"2026-08-06T18:21:42.958671Z"},"links":{"citing_paper":"/paper/2507.08555"},"observation_digest":"sha256:2271692017d74c94eebc7433b45556f12c205f2b7a8e25eef062028d5194f1b6","observation_id":"9b3c79a7-76a4-4008-b44e-af1d3f0880e6","resolution":{"observed_at":"2026-08-06T18:21:44.126368Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T18:21:43.924444Z","title":"Occformer: Dual-path transformer for vision-based 3d semantic occu- pancy prediction","venue":null,"work_id":"6bd3b0e4-42b7-4a3c-b32a-4d4fb23421e0","year":2023},"citing_paper":{"arxiv_id":"2507.08555","last_updated":"2025-07-11T12:57:14Z","snapshot_observed_at":"2026-08-11T06:18:38.166652Z","submitted_at":"2025-07-11T12:57:14Z","title":"Disentangling Instance and Scene Contexts for 3D Semantic Scene Completion","version":1},"reference_index":52,"source":"pdf_text","source_observed_at":"2026-08-06T18:21:43.030850Z"},"links":{"citing_paper":"/paper/2507.08555"},"observation_digest":"sha256:0aff66112f20172cabc911b8542a5d4fdb6dc3826374f7c70c1c59855e4a63df","observation_id":"e8cb02c0-f6b5-4a2c-97ac-55a0af893b4e","resolution":{"observed_at":"2026-08-06T18:21:43.969925Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T18:21:43.706053Z","title":"Monoocc: Digging into monocular semantic occu- pancy prediction","venue":null,"work_id":"320272c3-3fc8-40f8-b674-2d2446307fab","year":2024},"citing_paper":{"arxiv_id":"2507.08555","last_updated":"2025-07-11T12:57:14Z","snapshot_observed_at":"2026-08-11T06:18:38.166652Z","submitted_at":"2025-07-11T12:57:14Z","title":"Disentangling Instance and Scene Contexts for 3D Semantic Scene Completion","version":1},"reference_index":53,"source":"pdf_text","source_observed_at":"2026-08-06T18:21:43.120620Z"},"links":{"citing_paper":"/paper/2507.08555"},"observation_digest":"sha256:593d51a4c25f95feaf08bcf7423f343d41edb982281de010363cf533bc5bdc30","observation_id":"284f97fb-bcf0-4606-b213-5a8b7c881e93","resolution":{"observed_at":"2026-08-06T18:21:43.805047Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}}],"paper":{"arxiv_id":"2507.08555","last_updated":"2025-07-11T12:57:14Z","latest_version":1,"primary_category":"cs.CV","snapshot_observed_at":"2026-08-11T06:18:38.166652Z","submitted_at":"2025-07-11T12:57:14Z","title":"Disentangling Instance and Scene Contexts for 3D Semantic Scene Completion"},"reference_resolution":{"displayed":52,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":12,"verified_exact":1,"verified_fuzzy":39},"total_outbound_references":52},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"thesis":"As of 14 August 2026, this Paper Citation Record lists 52 of 52 outbound references and 0 inbound Pith citation observations for arXiv:2507.08555."}