{"as_of":"2026-08-11T00:10:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:0245fee475748d36592ab2995e849b889a73ae1f26b0b88d15c17f2f14951436","coverage":[{"denominator":42,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":42,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-06T13:10:19.700130Z","state":"measured"},{"denominator":42,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":42,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-10T06:31:04.303077+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2507.20963/citation-record","integrity":"/paper/2507.20963/integrity","json":"/paper/2507.20963/citation-record.json","paper":"/paper/2507.20963"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T13:10:19.563916Z","title":"Cross-view transformers for real-time map-view semantic segmentation,","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2507.20963","last_updated":"2025-07-28T16:18:29Z","snapshot_observed_at":"2026-08-09T00:58:50.572197Z","submitted_at":"2025-07-28T16:18:29Z","title":"GTAD: Global Temporal Aggregation Denoising Learning for 3D Semantic Occupancy Prediction","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-06T13:10:19.563916Z"},"links":{"citing_paper":"/paper/2507.20963"},"observation_digest":"sha256:8b33725ba0d37defac61ddf2d1fa076db48d732b2939be2db05bb872060b4c85","observation_id":"c7374141-010a-498b-9f80-ffa1faf65283","resolution":{"observed_at":"2026-08-06T13:10:19.563916Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T13:10:20.097026Z","title":"Lidar panoptic segmentation for autonomous driving,","venue":null,"work_id":"6ffe08c0-9ff9-4125-a80a-9922106dd722","year":2020},"citing_paper":{"arxiv_id":"2507.20963","last_updated":"2025-07-28T16:18:29Z","snapshot_observed_at":"2026-08-09T00:58:50.572197Z","submitted_at":"2025-07-28T16:18:29Z","title":"GTAD: Global Temporal Aggregation Denoising Learning for 3D Semantic Occupancy Prediction","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-06T13:10:19.567778Z"},"links":{"citing_paper":"/paper/2507.20963"},"observation_digest":"sha256:96e46dbde838a99ef1ba967dff8acfbf4503e042ac552c0f7feec308967bdfb8","observation_id":"1dfa4372-0044-43bb-ab68-fda120be3e9f","resolution":{"observed_at":"2026-08-06T13:10:20.100341Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T13:10:20.087084Z","title":"Fiery: future instance prediction in bird’s- eye view from surround monocular cameras,","venue":null,"work_id":"e5cc7701-9b92-4f96-9067-73c827318307","year":2021},"citing_paper":{"arxiv_id":"2507.20963","last_updated":"2025-07-28T16:18:29Z","snapshot_observed_at":"2026-08-09T00:58:50.572197Z","submitted_at":"2025-07-28T16:18:29Z","title":"GTAD: Global Temporal Aggregation Denoising Learning for 3D Semantic Occupancy Prediction","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-06T13:10:19.570850Z"},"links":{"citing_paper":"/paper/2507.20963"},"observation_digest":"sha256:480476d5a1a9047f5069aab04cbf9d92fc0589867b7143da76e1211d4936488d","observation_id":"3fe4e7c4-d2c1-45ea-b39c-afb2e5e336d3","resolution":{"observed_at":"2026-08-06T13:10:20.090627Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T13:10:20.077570Z","title":"Is pseudo- lidar needed for monocular 3d object detection?","venue":null,"work_id":"9ba59cd4-95a7-4b37-8353-34e386e06211","year":2021},"citing_paper":{"arxiv_id":"2507.20963","last_updated":"2025-07-28T16:18:29Z","snapshot_observed_at":"2026-08-09T00:58:50.572197Z","submitted_at":"2025-07-28T16:18:29Z","title":"GTAD: Global Temporal Aggregation Denoising Learning for 3D Semantic Occupancy Prediction","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-06T13:10:19.574043Z"},"links":{"citing_paper":"/paper/2507.20963"},"observation_digest":"sha256:69a6319e0068e846ccac9ba762a957054ffc32af796151443700afb830c8e6d7","observation_id":"b01364aa-ee59-49fd-b97a-81ecd8486927","resolution":{"observed_at":"2026-08-06T13:10:20.080767Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T13:10:19.577176Z","title":"MMDetection3D: OpenMMLab next-generation platform for general 3D object detection,","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2507.20963","last_updated":"2025-07-28T16:18:29Z","snapshot_observed_at":"2026-08-09T00:58:50.572197Z","submitted_at":"2025-07-28T16:18:29Z","title":"GTAD: Global Temporal Aggregation Denoising Learning for 3D Semantic Occupancy Prediction","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-06T13:10:19.577176Z"},"links":{"citing_paper":"/paper/2507.20963"},"observation_digest":"sha256:defd89f4e4bbb7e988c9c5ef8dd23eea4de20901638b11828730826f4d266e37","observation_id":"25df734d-e7c0-4289-80f9-b43f9842e40a","resolution":{"observed_at":"2026-08-06T13:10:19.577176Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2208.14437","last_updated":"2023-01-30T02:39:49Z","snapshot_observed_at":"2026-07-06T13:47:00.653824Z","submitted_at":"2022-08-30T17:55:59Z","title":"MapTR: Structured Modeling and Learning for Online Vectorized HD Map Construction","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2208.14437","snapshot_observed_at":"2026-08-06T13:10:19.580503Z","title":"Maptr: Structured modeling and learning for online vectorized hd map construction,","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2507.20963","last_updated":"2025-07-28T16:18:29Z","snapshot_observed_at":"2026-08-09T00:58:50.572197Z","submitted_at":"2025-07-28T16:18:29Z","title":"GTAD: Global Temporal Aggregation Denoising Learning for 3D Semantic Occupancy Prediction","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-06T13:10:19.580503Z"},"links":{"cited_paper":"/paper/2208.14437","citing_paper":"/paper/2507.20963"},"observation_digest":"sha256:c3c5b759c6c5b7827286aad29acbbeea6e99d154642fb86f95b845e20d043871","observation_id":"1e90ecda-84f2-4068-85b6-8d561276a44d","resolution":{"observed_at":"2026-08-06T13:10:19.580503Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T13:10:20.060339Z","title":"Predicting semantic map representations from images using pyramid occupancy networks,","venue":null,"work_id":"8347fd9f-d1f6-4e5e-9561-e7def81e90e2","year":2020},"citing_paper":{"arxiv_id":"2507.20963","last_updated":"2025-07-28T16:18:29Z","snapshot_observed_at":"2026-08-09T00:58:50.572197Z","submitted_at":"2025-07-28T16:18:29Z","title":"GTAD: Global Temporal Aggregation Denoising Learning for 3D Semantic Occupancy Prediction","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-06T13:10:19.585220Z"},"links":{"citing_paper":"/paper/2507.20963"},"observation_digest":"sha256:d9368fabbea2dc27fe882034d2207a629e0e35bf3ba51bfc315d2f45923fd79a","observation_id":"57f79c23-dccd-47de-b1aa-632fee207775","resolution":{"observed_at":"2026-08-06T13:10:20.063746Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2209.14201","last_updated":"2022-09-28T16:19:06Z","snapshot_observed_at":"2026-08-09T19:54:53.104976Z","submitted_at":"2022-09-28T16:19:06Z","title":"Spatial Pruned Sparse Convolution for Efficient 3D Object Detection","version":1},"cited_work":{"arxiv_id":"2209.14201","doi":null,"metadata_source":"pith","pith_arxiv_id":"2209.14201","snapshot_observed_at":"2026-08-06T13:10:19.905514Z","title":"Spatial Pruned Sparse Convolution for Efficient 3D Object Detection","venue":"cs.CV","work_id":"a79506ab-2e88-4a30-9fa2-df7ee7ff6638","year":2022},"citing_paper":{"arxiv_id":"2507.20963","last_updated":"2025-07-28T16:18:29Z","snapshot_observed_at":"2026-08-09T00:58:50.572197Z","submitted_at":"2025-07-28T16:18:29Z","title":"GTAD: Global Temporal Aggregation Denoising Learning for 3D Semantic Occupancy Prediction","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-06T13:10:19.588299Z"},"links":{"cited_paper":"/paper/2209.14201","citing_paper":"/paper/2507.20963"},"observation_digest":"sha256:ccdf3452fdcae60e78fcbab6b22c69707b9b45c1599c3b0efaceeb4e14a0ba3c","observation_id":"1288bc51-55a3-47cd-bc17-8d3222143c95","resolution":{"observed_at":"2026-08-06T13:10:19.910765Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T13:10:20.049706Z","title":"Multi- scale interaction for real-time lidar data segmentation on an embedded platform,","venue":null,"work_id":"7ef142b1-0cac-4813-90e1-801c3dbb56fd","year":2021},"citing_paper":{"arxiv_id":"2507.20963","last_updated":"2025-07-28T16:18:29Z","snapshot_observed_at":"2026-08-09T00:58:50.572197Z","submitted_at":"2025-07-28T16:18:29Z","title":"GTAD: Global Temporal Aggregation Denoising Learning for 3D Semantic Occupancy Prediction","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-06T13:10:19.591322Z"},"links":{"citing_paper":"/paper/2507.20963"},"observation_digest":"sha256:1c806ba60a4924cbeb0ec196c279cf927308cc668af686e6ee120f5d7c4edb34","observation_id":"0531a00b-8dfe-4666-8def-4c624ecf95dd","resolution":{"observed_at":"2026-08-06T13:10:20.053719Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2302.13540","last_updated":"2023-02-27T06:35:03Z","snapshot_observed_at":"2026-08-10T00:59:33.365723Z","submitted_at":"2023-02-27T06:35:03Z","title":"OccDepth: A Depth-Aware Method for 3D Semantic Scene Completion","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2302.13540","snapshot_observed_at":"2026-08-06T13:10:19.594413Z","title":"Occdepth: A depth-aware method for 3d semantic scene completion,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2507.20963","last_updated":"2025-07-28T16:18:29Z","snapshot_observed_at":"2026-08-09T00:58:50.572197Z","submitted_at":"2025-07-28T16:18:29Z","title":"GTAD: Global Temporal Aggregation Denoising Learning for 3D Semantic Occupancy Prediction","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-06T13:10:19.594413Z"},"links":{"cited_paper":"/paper/2302.13540","citing_paper":"/paper/2507.20963"},"observation_digest":"sha256:2d7e54886c1f60cb1d09152f20281cbe4a9c85acd92a2c645e40482e2f4c9e30","observation_id":"a7f60da8-91ab-436c-8eff-27b18bf49b9b","resolution":{"observed_at":"2026-08-06T13:10:19.594413Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2302.07817","last_updated":"2023-03-02T16:41:45Z","snapshot_observed_at":"2026-07-06T14:52:11.722960Z","submitted_at":"2023-02-15T17:58:10Z","title":"Tri-Perspective View for Vision-Based 3D Semantic Occupancy Prediction","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2302.07817","snapshot_observed_at":"2026-08-06T13:10:19.597569Z","title":"Tri-perspective view for vision-based 3d semantic occupancy prediction,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2507.20963","last_updated":"2025-07-28T16:18:29Z","snapshot_observed_at":"2026-08-09T00:58:50.572197Z","submitted_at":"2025-07-28T16:18:29Z","title":"GTAD: Global Temporal Aggregation Denoising Learning for 3D Semantic Occupancy Prediction","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-06T13:10:19.597569Z"},"links":{"cited_paper":"/paper/2302.07817","citing_paper":"/paper/2507.20963"},"observation_digest":"sha256:90f1e46d83ddbe9b447d8c0e6ece275a8fe237b43c8bf1b111a8b0d82f24fb36","observation_id":"31b5f350-4b0e-4f5c-bb66-a245ab55f5e6","resolution":{"observed_at":"2026-08-06T13:10:19.597569Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2303.03991","last_updated":"2023-03-07T15:43:39Z","snapshot_observed_at":"2026-07-06T14:59:46.707335Z","submitted_at":"2023-03-07T15:43:39Z","title":"OpenOccupancy: A Large Scale Benchmark for Surrounding Semantic Occupancy Perception","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2303.03991","snapshot_observed_at":"2026-08-06T13:10:19.600685Z","title":"Openoccupancy: A large scale benchmark for surround- ing semantic occupancy perception,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2507.20963","last_updated":"2025-07-28T16:18:29Z","snapshot_observed_at":"2026-08-09T00:58:50.572197Z","submitted_at":"2025-07-28T16:18:29Z","title":"GTAD: Global Temporal Aggregation Denoising Learning for 3D Semantic Occupancy Prediction","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-06T13:10:19.600685Z"},"links":{"cited_paper":"/paper/2303.03991","citing_paper":"/paper/2507.20963"},"observation_digest":"sha256:e6ca448321a893bc3e4ab143c9fae85108bd6e73c4d2aefbc3af39e9838ccb6c","observation_id":"1d2b38f5-756f-4ea2-ad60-2814fdb36b5a","resolution":{"observed_at":"2026-08-06T13:10:19.600685Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T13:10:20.039375Z","title":"V oxformer: Sparse voxel transformer for camera- based 3d semantic scene completion,","venue":null,"work_id":"2f95a426-34fd-4279-8276-812d34a24b8c","year":2023},"citing_paper":{"arxiv_id":"2507.20963","last_updated":"2025-07-28T16:18:29Z","snapshot_observed_at":"2026-08-09T00:58:50.572197Z","submitted_at":"2025-07-28T16:18:29Z","title":"GTAD: Global Temporal Aggregation Denoising Learning for 3D Semantic Occupancy Prediction","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-06T13:10:19.603874Z"},"links":{"citing_paper":"/paper/2507.20963"},"observation_digest":"sha256:7ca597797b9ee1e111c9502b26397f839f3be8005aed0726bd938164b66682ca","observation_id":"56a68fa4-b16e-470b-a27e-f3d8c920d688","resolution":{"observed_at":"2026-08-06T13:10:20.042611Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T13:10:19.607735Z","title":"Bevformer: Learning bird’s-eye-view representation from multi-camera images via spatiotemporal transformers,","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2507.20963","last_updated":"2025-07-28T16:18:29Z","snapshot_observed_at":"2026-08-09T00:58:50.572197Z","submitted_at":"2025-07-28T16:18:29Z","title":"GTAD: Global Temporal Aggregation Denoising Learning for 3D Semantic Occupancy Prediction","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-06T13:10:19.607735Z"},"links":{"citing_paper":"/paper/2507.20963"},"observation_digest":"sha256:cbaf13c7b3d20edfdc3c028bcd13e272cf3cf58f1b39894d5fd65531c6b82d6c","observation_id":"439806da-d21c-403e-89ca-8ea495261a99","resolution":{"observed_at":"2026-08-06T13:10:19.607735Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2407.07587","last_updated":"2024-10-08T11:07:08Z","snapshot_observed_at":"2026-08-05T16:35:01.719928Z","submitted_at":"2024-07-10T12:20:11Z","title":"Let Occ Flow: Self-Supervised 3D Occupancy Flow Prediction","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2407.07587","snapshot_observed_at":"2026-08-06T13:10:19.610656Z","title":"Let occ flow: Self-supervised 3d occupancy flow prediction,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.20963","last_updated":"2025-07-28T16:18:29Z","snapshot_observed_at":"2026-08-09T00:58:50.572197Z","submitted_at":"2025-07-28T16:18:29Z","title":"GTAD: Global Temporal Aggregation Denoising Learning for 3D Semantic Occupancy Prediction","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-06T13:10:19.610656Z"},"links":{"cited_paper":"/paper/2407.07587","citing_paper":"/paper/2507.20963"},"observation_digest":"sha256:558f051f64f2a6681fda4c0128f668828b1c7b04b3b6ff55b8f1f550082ff0bc","observation_id":"67590b7a-4b4d-4e37-bf6c-26cd78b0ff9b","resolution":{"observed_at":"2026-08-06T13:10:19.610656Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T13:10:20.022434Z","title":"Panoocc: Unified occupancy representation for camera-based 3d panoptic segmentation,","venue":null,"work_id":"8db9bb1e-ec77-455d-9ec5-1eced0af48b1","year":null},"citing_paper":{"arxiv_id":"2507.20963","last_updated":"2025-07-28T16:18:29Z","snapshot_observed_at":"2026-08-09T00:58:50.572197Z","submitted_at":"2025-07-28T16:18:29Z","title":"GTAD: Global Temporal Aggregation Denoising Learning for 3D Semantic Occupancy Prediction","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-06T13:10:19.614448Z"},"links":{"citing_paper":"/paper/2507.20963"},"observation_digest":"sha256:c9abd416bcc5e3a921ac3aeba1c9a6a5167bc56859d23aff8fee3ea74757b9c3","observation_id":"4e830e7d-fe74-4173-b551-e1aba64cd519","resolution":{"observed_at":"2026-08-06T13:10:20.025852Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2404.02517","last_updated":"2024-09-18T06:33:32Z","snapshot_observed_at":"2026-08-02T00:17:39.810357Z","submitted_at":"2024-04-03T07:10:18Z","title":"HENet: Hybrid Encoding for End-to-end Multi-task 3D Perception from Multi-view Cameras","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2404.02517","snapshot_observed_at":"2026-08-06T13:10:19.620413Z","title":"Henet: Hybrid encoding for end-to-end multi-task 3d perception from multi-view cameras,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.20963","last_updated":"2025-07-28T16:18:29Z","snapshot_observed_at":"2026-08-09T00:58:50.572197Z","submitted_at":"2025-07-28T16:18:29Z","title":"GTAD: Global Temporal Aggregation Denoising Learning for 3D Semantic Occupancy Prediction","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-06T13:10:19.620413Z"},"links":{"cited_paper":"/paper/2404.02517","citing_paper":"/paper/2507.20963"},"observation_digest":"sha256:c4e9ed81e9f358ad707b0086a7afbb1b798228729d7c0d9055ca5d38756ff1cb","observation_id":"d4d5604d-1b5c-4f61-a7c4-2c311c304f67","resolution":{"observed_at":"2026-08-06T13:10:19.620413Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2203.17054","last_updated":"2022-06-16T09:44:08Z","snapshot_observed_at":"2026-07-06T12:55:16.868412Z","submitted_at":"2022-03-31T14:21:19Z","title":"BEVDet4D: Exploit Temporal Cues in Multi-camera 3D Object Detection","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2203.17054","snapshot_observed_at":"2026-08-06T13:10:19.623400Z","title":"Bevdet4d: Exploit temporal cues in multi-camera 3d object detection,","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2507.20963","last_updated":"2025-07-28T16:18:29Z","snapshot_observed_at":"2026-08-09T00:58:50.572197Z","submitted_at":"2025-07-28T16:18:29Z","title":"GTAD: Global Temporal Aggregation Denoising Learning for 3D Semantic Occupancy Prediction","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-06T13:10:19.623400Z"},"links":{"cited_paper":"/paper/2203.17054","citing_paper":"/paper/2507.20963"},"observation_digest":"sha256:8c4360ec27fd4c3006ecfc24f884b16caaf1413a31df7d1a4f87ba26bfc12d26","observation_id":"c1a9020e-40b5-4820-a9cc-0f5bae69602c","resolution":{"observed_at":"2026-08-06T13:10:19.623400Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2006.11239","last_updated":"2020-12-16T21:15:05Z","snapshot_observed_at":"2026-08-10T05:21:27.485481Z","submitted_at":"2020-06-19T17:24:44Z","title":"Denoising Diffusion Probabilistic Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2006.11239","snapshot_observed_at":"2026-08-06T13:10:19.629792Z","title":"Denoising diffusion probabilistic models,","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2507.20963","last_updated":"2025-07-28T16:18:29Z","snapshot_observed_at":"2026-08-09T00:58:50.572197Z","submitted_at":"2025-07-28T16:18:29Z","title":"GTAD: Global Temporal Aggregation Denoising Learning for 3D Semantic Occupancy Prediction","version":1},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-06T13:10:19.629792Z"},"links":{"cited_paper":"/paper/2006.11239","citing_paper":"/paper/2507.20963"},"observation_digest":"sha256:86c7d1efc197c479038b56facffb97adbbbb727efe736de646e8fa183bec457e","observation_id":"258ef602-6e01-4852-b133-2f98b7494ce5","resolution":{"observed_at":"2026-08-06T13:10:19.629792Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2501.02467","last_updated":"2025-01-05T07:28:50Z","snapshot_observed_at":"2026-08-10T22:09:56.190332Z","submitted_at":"2025-01-05T07:28:50Z","title":"DeTrack: In-model Latent Denoising Learning for Visual Object Tracking","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2501.02467","snapshot_observed_at":"2026-08-06T13:10:19.632615Z","title":"Detrack: In-model latent denoising learning for visual object tracking,","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2507.20963","last_updated":"2025-07-28T16:18:29Z","snapshot_observed_at":"2026-08-09T00:58:50.572197Z","submitted_at":"2025-07-28T16:18:29Z","title":"GTAD: Global Temporal Aggregation Denoising Learning for 3D Semantic Occupancy Prediction","version":1},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-06T13:10:19.632615Z"},"links":{"cited_paper":"/paper/2501.02467","citing_paper":"/paper/2507.20963"},"observation_digest":"sha256:044d96ab233b779e3f24a96d8084dd11e9d353850d1e299a4f0a8a6a40e8833d","observation_id":"53445377-b1ec-417e-9c52-9c638e96e9cb","resolution":{"observed_at":"2026-08-06T13:10:19.632615Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2304.14365","last_updated":"2023-12-13T17:41:17Z","snapshot_observed_at":"2026-08-10T11:10:28.715548Z","submitted_at":"2023-04-27T17:40:08Z","title":"Occ3D: A Large-Scale 3D Occupancy Prediction Benchmark for Autonomous Driving","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2304.14365","snapshot_observed_at":"2026-08-06T13:10:19.636072Z","title":"Occ3d: A large-scale 3d occupancy prediction benchmark for autonomous driving,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2507.20963","last_updated":"2025-07-28T16:18:29Z","snapshot_observed_at":"2026-08-09T00:58:50.572197Z","submitted_at":"2025-07-28T16:18:29Z","title":"GTAD: Global Temporal Aggregation Denoising Learning for 3D Semantic Occupancy Prediction","version":1},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-06T13:10:19.636072Z"},"links":{"cited_paper":"/paper/2304.14365","citing_paper":"/paper/2507.20963"},"observation_digest":"sha256:38aae49547c896c2bde7eb993af402da2bea77949b49f4e7a89912524cceeb1a","observation_id":"1e82a5dc-f235-400c-bcc9-f27077a3514e","resolution":{"observed_at":"2026-08-06T13:10:19.636072Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T13:10:20.011296Z","title":"Monoscene: Monocular 3d semantic scene completion,","venue":null,"work_id":"ffd71874-e53b-4fe5-acfb-700fb20119c2","year":2022},"citing_paper":{"arxiv_id":"2507.20963","last_updated":"2025-07-28T16:18:29Z","snapshot_observed_at":"2026-08-09T00:58:50.572197Z","submitted_at":"2025-07-28T16:18:29Z","title":"GTAD: Global Temporal Aggregation Denoising Learning for 3D Semantic Occupancy Prediction","version":1},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-06T13:10:19.639272Z"},"links":{"citing_paper":"/paper/2507.20963"},"observation_digest":"sha256:c1fc2ee0df00d73e2823169c01fa799283350e3d02a7019432aee1ad3b8135a2","observation_id":"a03adaa1-9580-44d6-8642-8d520feb71f1","resolution":{"observed_at":"2026-08-06T13:10:20.014767Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2010.04159","last_updated":"2021-03-18T03:14:26Z","snapshot_observed_at":"2026-07-06T10:02:45.105181Z","submitted_at":"2020-10-08T17:59:21Z","title":"Deformable DETR: Deformable Transformers for End-to-End Object Detection","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2010.04159","snapshot_observed_at":"2026-08-06T13:10:19.642327Z","title":"Deformable detr: Deformable transformers for end-to-end object detection,","venue":null,"work_id":null,"year":2010},"citing_paper":{"arxiv_id":"2507.20963","last_updated":"2025-07-28T16:18:29Z","snapshot_observed_at":"2026-08-09T00:58:50.572197Z","submitted_at":"2025-07-28T16:18:29Z","title":"GTAD: Global Temporal Aggregation Denoising Learning for 3D Semantic Occupancy Prediction","version":1},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-06T13:10:19.642327Z"},"links":{"cited_paper":"/paper/2010.04159","citing_paper":"/paper/2507.20963"},"observation_digest":"sha256:a6935dfbed48799fcc287265ad4b3e7d5a0a5f418668ce77f15b0d042942e7c7","observation_id":"c7dd359f-694c-4c90-9b1e-fbfabddeea96","resolution":{"observed_at":"2026-08-06T13:10:19.642327Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2111.08318","last_updated":"2021-11-16T09:22:15Z","snapshot_observed_at":"2026-07-06T12:08:57.241574Z","submitted_at":"2021-11-16T09:22:15Z","title":"DRINet++: Efficient Voxel-as-point Point Cloud Segmentation","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2111.08318","snapshot_observed_at":"2026-08-06T13:10:19.645769Z","title":"Drinet++: Ef- ficient voxel-as-point point cloud segmentation,","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2507.20963","last_updated":"2025-07-28T16:18:29Z","snapshot_observed_at":"2026-08-09T00:58:50.572197Z","submitted_at":"2025-07-28T16:18:29Z","title":"GTAD: Global Temporal Aggregation Denoising Learning for 3D Semantic Occupancy Prediction","version":1},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-08-06T13:10:19.645769Z"},"links":{"cited_paper":"/paper/2111.08318","citing_paper":"/paper/2507.20963"},"observation_digest":"sha256:84534a02826e60cad75a8b99a6042a7ae5e6853a5f8d3b1071c578e2e62071f0","observation_id":"6f7e6e98-e4a8-41fd-8f72-11a176c101e2","resolution":{"observed_at":"2026-08-06T13:10:19.645769Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T13:10:19.649487Z","title":"Search- ing efficient 3d architectures with sparse point-voxel convolution,","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2507.20963","last_updated":"2025-07-28T16:18:29Z","snapshot_observed_at":"2026-08-09T00:58:50.572197Z","submitted_at":"2025-07-28T16:18:29Z","title":"GTAD: Global Temporal Aggregation Denoising Learning for 3D Semantic Occupancy Prediction","version":1},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-08-06T13:10:19.649487Z"},"links":{"citing_paper":"/paper/2507.20963"},"observation_digest":"sha256:343e10c1be0e7cda1afe8e5988c0e755bbb50a4d32c8c1529f07dfd1b591bdab","observation_id":"cf0aba89-01e4-4ef1-9e61-9408acfecdd3","resolution":{"observed_at":"2026-08-06T13:10:19.649487Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T13:10:19.994727Z","title":"Deepvoxels: Learning persistent 3d feature embeddings,","venue":null,"work_id":"5e8d2908-14db-430d-a1f8-c40805c1946f","year":2019},"citing_paper":{"arxiv_id":"2507.20963","last_updated":"2025-07-28T16:18:29Z","snapshot_observed_at":"2026-08-09T00:58:50.572197Z","submitted_at":"2025-07-28T16:18:29Z","title":"GTAD: Global Temporal Aggregation Denoising Learning for 3D Semantic Occupancy Prediction","version":1},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-08-06T13:10:19.652260Z"},"links":{"citing_paper":"/paper/2507.20963"},"observation_digest":"sha256:bf9128c84ab508ed5cd00df8a0bca00b8366456025d8b1f02d5dd0af7da49b26","observation_id":"b5a952e3-f91e-4b85-8964-dabafbc4555b","resolution":{"observed_at":"2026-08-06T13:10:19.997933Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2209.10248","last_updated":"2022-09-21T10:21:25Z","snapshot_observed_at":"2026-07-06T13:54:41.673948Z","submitted_at":"2022-09-21T10:21:25Z","title":"BEVStereo: Enhancing Depth Estimation in Multi-view 3D Object Detection with Dynamic Temporal Stereo","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2209.10248","snapshot_observed_at":"2026-08-06T13:10:19.655037Z","title":"Bevstereo: Enhancing depth estimation in multi-view 3d object detection with dynamic temporal stereo,","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2507.20963","last_updated":"2025-07-28T16:18:29Z","snapshot_observed_at":"2026-08-09T00:58:50.572197Z","submitted_at":"2025-07-28T16:18:29Z","title":"GTAD: Global Temporal Aggregation Denoising Learning for 3D Semantic Occupancy Prediction","version":1},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-08-06T13:10:19.655037Z"},"links":{"cited_paper":"/paper/2209.10248","citing_paper":"/paper/2507.20963"},"observation_digest":"sha256:0f3a96a58f971191c21123fb67b0775e19ba19eac242da1fe2e47f63e91e12f2","observation_id":"1ac2cb44-4b75-48fc-8693-e62c4f323582","resolution":{"observed_at":"2026-08-06T13:10:19.655037Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2112.11790","last_updated":"2022-06-16T09:15:52Z","snapshot_observed_at":"2026-07-06T12:21:28.059661Z","submitted_at":"2021-12-22T10:48:06Z","title":"BEVDet: High-performance Multi-camera 3D Object Detection in Bird-Eye-View","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2112.11790","snapshot_observed_at":"2026-08-06T13:10:19.658377Z","title":"Bevdet: High-performance multi-camera 3d object detection in bird-eye-view,","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2507.20963","last_updated":"2025-07-28T16:18:29Z","snapshot_observed_at":"2026-08-09T00:58:50.572197Z","submitted_at":"2025-07-28T16:18:29Z","title":"GTAD: Global Temporal Aggregation Denoising Learning for 3D Semantic Occupancy Prediction","version":1},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-08-06T13:10:19.658377Z"},"links":{"cited_paper":"/paper/2112.11790","citing_paper":"/paper/2507.20963"},"observation_digest":"sha256:453eba07aef8590c9036c23955b273103ec19abd70524cf9c6eaa2e4e8a9c298","observation_id":"5d388c37-6e47-405a-8b7d-541aaada7d42","resolution":{"observed_at":"2026-08-06T13:10:19.658377Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2206.10092","last_updated":"2022-11-30T11:28:11Z","snapshot_observed_at":"2026-08-09T19:53:57.316379Z","submitted_at":"2022-06-21T03:21:18Z","title":"BEVDepth: Acquisition of Reliable Depth for Multi-view 3D Object Detection","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2206.10092","snapshot_observed_at":"2026-08-06T13:10:19.661686Z","title":"Bevdepth: Acquisition of reliable depth for multi-view 3d object detection,","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2507.20963","last_updated":"2025-07-28T16:18:29Z","snapshot_observed_at":"2026-08-09T00:58:50.572197Z","submitted_at":"2025-07-28T16:18:29Z","title":"GTAD: Global Temporal Aggregation Denoising Learning for 3D Semantic Occupancy Prediction","version":1},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-08-06T13:10:19.661686Z"},"links":{"cited_paper":"/paper/2206.10092","citing_paper":"/paper/2507.20963"},"observation_digest":"sha256:c5c3df38aa31d47fbd80d4abb4c402a48d3c4523af64e9ecc62fb11478703313","observation_id":"9e1ce769-8d07-4799-8ffc-ff03fae697a9","resolution":{"observed_at":"2026-08-06T13:10:19.661686Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T13:10:19.985418Z","title":"Fb-bev: Bev representation from forward-backward view transforma- tions,","venue":null,"work_id":"fe8cef9d-469a-4cd8-975c-7855b8656b78","year":2023},"citing_paper":{"arxiv_id":"2507.20963","last_updated":"2025-07-28T16:18:29Z","snapshot_observed_at":"2026-08-09T00:58:50.572197Z","submitted_at":"2025-07-28T16:18:29Z","title":"GTAD: Global Temporal Aggregation Denoising Learning for 3D Semantic Occupancy Prediction","version":1},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-08-06T13:10:19.665126Z"},"links":{"citing_paper":"/paper/2507.20963"},"observation_digest":"sha256:417d2fcf5adca8f062e68cbbb9249a6f8f5737a0a3175b8724bdf3d75ea5b453","observation_id":"2d5833da-06e8-47c6-9b29-e4e6a6b478de","resolution":{"observed_at":"2026-08-06T13:10:19.988569Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T13:10:19.975125Z","title":"Bev-lanedet: a simple and effective 3d lane detection baseline,","venue":null,"work_id":"5c19341f-de25-43f3-bd00-0bb75565a1b4","year":2023},"citing_paper":{"arxiv_id":"2507.20963","last_updated":"2025-07-28T16:18:29Z","snapshot_observed_at":"2026-08-09T00:58:50.572197Z","submitted_at":"2025-07-28T16:18:29Z","title":"GTAD: Global Temporal Aggregation Denoising Learning for 3D Semantic Occupancy Prediction","version":1},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-08-06T13:10:19.668530Z"},"links":{"citing_paper":"/paper/2507.20963"},"observation_digest":"sha256:2faf7430c06fcd8395e908d4ac597eb25472a7e2ee0a6f5a1ea47ef64978636f","observation_id":"e6b0ca9e-0602-41d3-bb94-808e2efe7828","resolution":{"observed_at":"2026-08-06T13:10:19.978483Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2211.17111","last_updated":"2022-11-30T15:55:38Z","snapshot_observed_at":"2026-08-05T20:16:02.949910Z","submitted_at":"2022-11-30T15:55:38Z","title":"BEVPoolv2: A Cutting-edge Implementation of BEVDet Toward Deployment","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2211.17111","snapshot_observed_at":"2026-08-06T13:10:19.671864Z","title":"Bevpoolv2: A cutting-edge implementa- tion of bevdet toward deployment,","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2507.20963","last_updated":"2025-07-28T16:18:29Z","snapshot_observed_at":"2026-08-09T00:58:50.572197Z","submitted_at":"2025-07-28T16:18:29Z","title":"GTAD: Global Temporal Aggregation Denoising Learning for 3D Semantic Occupancy Prediction","version":1},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-08-06T13:10:19.671864Z"},"links":{"cited_paper":"/paper/2211.17111","citing_paper":"/paper/2507.20963"},"observation_digest":"sha256:c076136fc89019919aa64a75f826bb92982d3b2e787bf1d3e584e1012d9f20d2","observation_id":"3f179b53-af08-45c0-8b07-880544e8b806","resolution":{"observed_at":"2026-08-06T13:10:19.671864Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2301.07870","last_updated":"2023-01-19T03:58:48Z","snapshot_observed_at":"2026-08-08T04:45:40.227903Z","submitted_at":"2023-01-19T03:58:48Z","title":"Fast-BEV: Towards Real-time On-vehicle Bird's-Eye View Perception","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2301.07870","snapshot_observed_at":"2026-08-06T13:10:19.675413Z","title":"Fast-bev: Towards real-time on-vehicle bird’s-eye view perception,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2507.20963","last_updated":"2025-07-28T16:18:29Z","snapshot_observed_at":"2026-08-09T00:58:50.572197Z","submitted_at":"2025-07-28T16:18:29Z","title":"GTAD: Global Temporal Aggregation Denoising Learning for 3D Semantic Occupancy Prediction","version":1},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-08-06T13:10:19.675413Z"},"links":{"cited_paper":"/paper/2301.07870","citing_paper":"/paper/2507.20963"},"observation_digest":"sha256:642d3c61927d7e395832854c31a876c57e89728823f617c06cd5a68e2cdbc1fe","observation_id":"b016de49-931b-416e-8d50-60812544b475","resolution":{"observed_at":"2026-08-06T13:10:19.675413Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T13:10:19.678625Z","title":"Focal loss for dense object detection,","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2507.20963","last_updated":"2025-07-28T16:18:29Z","snapshot_observed_at":"2026-08-09T00:58:50.572197Z","submitted_at":"2025-07-28T16:18:29Z","title":"GTAD: Global Temporal Aggregation Denoising Learning for 3D Semantic Occupancy Prediction","version":1},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-08-06T13:10:19.678625Z"},"links":{"citing_paper":"/paper/2507.20963"},"observation_digest":"sha256:aa39c24b8f0504fb35291565262b340cd268ced15c198cd5a9e1b0e4ae7c0da9","observation_id":"03e0f2ca-9551-4cc6-a983-a4da53212b0f","resolution":{"observed_at":"2026-08-06T13:10:19.678625Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T13:10:19.959763Z","title":"The lov ´asz-softmax loss: A tractable surrogate for the optimization of the intersection- over-union measure in neural networks,","venue":null,"work_id":"df4745c9-48fd-4976-8717-57377b952979","year":2018},"citing_paper":{"arxiv_id":"2507.20963","last_updated":"2025-07-28T16:18:29Z","snapshot_observed_at":"2026-08-09T00:58:50.572197Z","submitted_at":"2025-07-28T16:18:29Z","title":"GTAD: Global Temporal Aggregation Denoising Learning for 3D Semantic Occupancy Prediction","version":1},"reference_index":36,"source":"pdf_text","source_observed_at":"2026-08-06T13:10:19.681530Z"},"links":{"citing_paper":"/paper/2507.20963"},"observation_digest":"sha256:e0a6407bfb27daf42005de26d0696c0ca59147cbb13ba7045d01fe4e04ceb6c1","observation_id":"e6b9a5a9-58f5-4fd7-af79-c421eec93416","resolution":{"observed_at":"2026-08-06T13:10:19.962703Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T13:10:19.684605Z","title":"nuscenes: A multimodal dataset for autonomous driving,","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2507.20963","last_updated":"2025-07-28T16:18:29Z","snapshot_observed_at":"2026-08-09T00:58:50.572197Z","submitted_at":"2025-07-28T16:18:29Z","title":"GTAD: Global Temporal Aggregation Denoising Learning for 3D Semantic Occupancy Prediction","version":1},"reference_index":37,"source":"pdf_text","source_observed_at":"2026-08-06T13:10:19.684605Z"},"links":{"citing_paper":"/paper/2507.20963"},"observation_digest":"sha256:3694c61ec70ef8760ae589bd3a11e548529a27c8396101bcaae1e80e6d10847b","observation_id":"25eac546-1918-418b-98f8-7b30c497bfd8","resolution":{"observed_at":"2026-08-06T13:10:19.684605Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2211.05778","last_updated":"2023-04-17T11:51:12Z","snapshot_observed_at":"2026-07-06T14:16:52.598523Z","submitted_at":"2022-11-10T18:59:04Z","title":"InternImage: Exploring Large-Scale Vision Foundation Models with Deformable Convolutions","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2211.05778","snapshot_observed_at":"2026-08-06T13:10:19.687685Z","title":"Internimage: Exploring large-scale vision foundation models with deformable convolutions,","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2507.20963","last_updated":"2025-07-28T16:18:29Z","snapshot_observed_at":"2026-08-09T00:58:50.572197Z","submitted_at":"2025-07-28T16:18:29Z","title":"GTAD: Global Temporal Aggregation Denoising Learning for 3D Semantic Occupancy Prediction","version":1},"reference_index":38,"source":"pdf_text","source_observed_at":"2026-08-06T13:10:19.687685Z"},"links":{"cited_paper":"/paper/2211.05778","citing_paper":"/paper/2507.20963"},"observation_digest":"sha256:98c44c8870e2afa525afe768aadc1b7205aeedfee3b0a1019058258e2aabf004","observation_id":"16d200ed-55ca-44ae-9ac0-dd417168cd57","resolution":{"observed_at":"2026-08-06T13:10:19.687685Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T13:10:19.690820Z","title":"Deep residual learning for image recognition,","venue":null,"work_id":null,"year":2016},"citing_paper":{"arxiv_id":"2507.20963","last_updated":"2025-07-28T16:18:29Z","snapshot_observed_at":"2026-08-09T00:58:50.572197Z","submitted_at":"2025-07-28T16:18:29Z","title":"GTAD: Global Temporal Aggregation Denoising Learning for 3D Semantic Occupancy Prediction","version":1},"reference_index":39,"source":"pdf_text","source_observed_at":"2026-08-06T13:10:19.690820Z"},"links":{"citing_paper":"/paper/2507.20963"},"observation_digest":"sha256:f7453c55aaf803cdbcba97fd18521ca8a3f0f4f24bbe4566b824d5dc5616bbe5","observation_id":"8b27219d-2a9f-4aff-bb94-2ec0b5228384","resolution":{"observed_at":"2026-08-06T13:10:19.690820Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T13:10:19.937917Z","title":"Improving deep neural networks using softplus units,","venue":null,"work_id":"bac4e2d9-a846-419d-b96a-3e807dd2babe","year":2015},"citing_paper":{"arxiv_id":"2507.20963","last_updated":"2025-07-28T16:18:29Z","snapshot_observed_at":"2026-08-09T00:58:50.572197Z","submitted_at":"2025-07-28T16:18:29Z","title":"GTAD: Global Temporal Aggregation Denoising Learning for 3D Semantic Occupancy Prediction","version":1},"reference_index":40,"source":"pdf_text","source_observed_at":"2026-08-06T13:10:19.693952Z"},"links":{"citing_paper":"/paper/2507.20963"},"observation_digest":"sha256:980bc5e854ef9324cad1e53139ea8de9f8416e0d498b6a35bf9b04522a0110dd","observation_id":"83155d89-7887-408e-9f7e-c901a983992e","resolution":{"observed_at":"2026-08-06T13:10:19.941420Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1711.05101","last_updated":"2019-01-04T21:01:49Z","snapshot_observed_at":"2026-08-09T20:34:52.923500Z","submitted_at":"2017-11-14T14:24:06Z","title":"Decoupled Weight Decay Regularization","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1711.05101","snapshot_observed_at":"2026-08-06T13:10:19.696727Z","title":"Decoupled weight decay regularization,","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2507.20963","last_updated":"2025-07-28T16:18:29Z","snapshot_observed_at":"2026-08-09T00:58:50.572197Z","submitted_at":"2025-07-28T16:18:29Z","title":"GTAD: Global Temporal Aggregation Denoising Learning for 3D Semantic Occupancy Prediction","version":1},"reference_index":41,"source":"pdf_text","source_observed_at":"2026-08-06T13:10:19.696727Z"},"links":{"cited_paper":"/paper/1711.05101","citing_paper":"/paper/2507.20963"},"observation_digest":"sha256:eec2b679cabcf42248a06914162a8df17991a31b508844c56ba1e223a9089829","observation_id":"f1737001-4f76-4b51-bee9-e2db65199c7e","resolution":{"observed_at":"2026-08-06T13:10:19.696727Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T13:10:19.928431Z","title":"Fcos3d: Fully convolutional one-stage monocular 3d object detection,","venue":null,"work_id":"8138eabd-a725-4401-9f90-df369248891d","year":2021},"citing_paper":{"arxiv_id":"2507.20963","last_updated":"2025-07-28T16:18:29Z","snapshot_observed_at":"2026-08-09T00:58:50.572197Z","submitted_at":"2025-07-28T16:18:29Z","title":"GTAD: Global Temporal Aggregation Denoising Learning for 3D Semantic Occupancy Prediction","version":1},"reference_index":42,"source":"pdf_text","source_observed_at":"2026-08-06T13:10:19.700130Z"},"links":{"citing_paper":"/paper/2507.20963"},"observation_digest":"sha256:1b4ad5b3585941ed065689ca121384c962c87fa9d306cf381082893c964d3135","observation_id":"2544c67f-1ff2-44ba-b471-dcc678288944","resolution":{"observed_at":"2026-08-06T13:10:19.931481Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2306.10013","last_updated":"2023-06-16T17:59:33Z","snapshot_observed_at":"2026-07-06T15:43:35.260552Z","submitted_at":"2023-06-16T17:59:33Z","title":"PanoOcc: Unified Occupancy Representation for Camera-based 3D Panoptic Segmentation","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2306.10013","snapshot_observed_at":"2026-08-06T13:10:19.617353Z","title":"Available: https://arxiv.org/abs/2306.10013","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2507.20963","last_updated":"2025-07-28T16:18:29Z","snapshot_observed_at":"2026-08-09T00:58:50.572197Z","submitted_at":"2025-07-28T16:18:29Z","title":"GTAD: Global Temporal Aggregation Denoising Learning for 3D Semantic Occupancy Prediction","version":1},"reference_index":2023,"source":"pdf_text","source_observed_at":"2026-08-06T13:10:19.617353Z"},"links":{"cited_paper":"/paper/2306.10013","citing_paper":"/paper/2507.20963"},"observation_digest":"sha256:cb69aefc6233112d6df8fdc31e0f50f18d5e13c11eea1b1f0ecb79aef7abc34f","observation_id":"4a3c837c-6787-4cc6-9a22-ab7410776dc1","resolution":{"observed_at":"2026-08-06T13:10:19.617353Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"paper":{"arxiv_id":"2507.20963","last_updated":"2025-07-28T16:18:29Z","latest_version":1,"primary_category":"cs.CV","snapshot_observed_at":"2026-08-09T00:58:50.572197Z","submitted_at":"2025-07-28T16:18:29Z","title":"GTAD: Global Temporal Aggregation Denoising Learning for 3D Semantic Occupancy Prediction"},"reference_resolution":{"displayed":42,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":27,"verified_exact":1,"verified_fuzzy":14},"total_outbound_references":42},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"thesis":"As of 11 August 2026, this Paper Citation Record lists 42 of 42 outbound references and 0 inbound Pith citation observations for arXiv:2507.20963."}