{"as_of":"2026-08-19T19:33:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:43cab71f26c6fa7611f4c0ab1627563857de381653770e2e73ee56e108296d09","coverage":[{"denominator":42,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":42,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-12T15:32:47.491471Z","state":"measured"},{"denominator":42,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":42,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-19T06:32:44.657259+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2411.14169/citation-record","integrity":"/paper/2411.14169/integrity","json":"/paper/2411.14169/citation-record.json","paper":"/paper/2411.14169"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T15:32:47.318014Z","title":"Monoscene: Monocular 3d semantic scene completion,","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2411.14169","last_updated":"2024-11-21T14:27:15Z","snapshot_observed_at":"2026-08-16T11:14:18.409392Z","submitted_at":"2024-11-21T14:27:15Z","title":"Spatiotemporal Decoupling for Efficient Vision-Based Occupancy Forecasting","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-12T15:32:47.318014Z"},"links":{"citing_paper":"/paper/2411.14169"},"observation_digest":"sha256:92d96fac9df3bb4621cd1b45ea54810087703caf4abf4e27c6f7bd5dd5f29eee","observation_id":"3504bf93-38b5-4faa-9183-f56ef013a858","resolution":{"observed_at":"2026-08-12T15:32:47.318014Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T15:32:47.322650Z","title":"Openoccupancy: A large scale benchmark for surrounding semantic occupancy perception,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2411.14169","last_updated":"2024-11-21T14:27:15Z","snapshot_observed_at":"2026-08-16T11:14:18.409392Z","submitted_at":"2024-11-21T14:27:15Z","title":"Spatiotemporal Decoupling for Efficient Vision-Based Occupancy Forecasting","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-12T15:32:47.322650Z"},"links":{"citing_paper":"/paper/2411.14169"},"observation_digest":"sha256:c3a548d62b4badd3175b8cbffc60745487b1cc6b7d4629a36577047d2cf35795","observation_id":"6bd4257c-386e-4249-857c-82b4ac9de964","resolution":{"observed_at":"2026-08-12T15:32:47.322650Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T15:32:48.119538Z","title":"V oxformer: Sparse voxel transformer for camera- based 3d semantic scene completion,","venue":null,"work_id":"e814ec2e-0f4f-4eff-9f6e-a19f52cd2921","year":2023},"citing_paper":{"arxiv_id":"2411.14169","last_updated":"2024-11-21T14:27:15Z","snapshot_observed_at":"2026-08-16T11:14:18.409392Z","submitted_at":"2024-11-21T14:27:15Z","title":"Spatiotemporal Decoupling for Efficient Vision-Based Occupancy Forecasting","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-12T15:32:47.326448Z"},"links":{"citing_paper":"/paper/2411.14169"},"observation_digest":"sha256:14bcd7941b697dbbe943a8fa70bdd6a5de5fb97d27d7bc3382eb1171d3a7866e","observation_id":"a42b20e5-74db-4914-b20a-29709dde10df","resolution":{"observed_at":"2026-08-12T15:32:48.123309Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T15:32:48.108014Z","title":"Occformer: Dual-path transformer for vision-based 3d semantic occupancy prediction,","venue":null,"work_id":"8cb3d5f5-8456-4683-a418-17e1e959a370","year":2023},"citing_paper":{"arxiv_id":"2411.14169","last_updated":"2024-11-21T14:27:15Z","snapshot_observed_at":"2026-08-16T11:14:18.409392Z","submitted_at":"2024-11-21T14:27:15Z","title":"Spatiotemporal Decoupling for Efficient Vision-Based Occupancy Forecasting","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-12T15:32:47.330485Z"},"links":{"citing_paper":"/paper/2411.14169"},"observation_digest":"sha256:717309e192f208a4fae7dcf219148f00d2eef39b6342c13be1bf5e71b8db3e60","observation_id":"e97cf924-ae70-4cf7-8a9c-02e156cd4401","resolution":{"observed_at":"2026-08-12T15:32:48.112358Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T15:32:48.095506Z","title":"Tri-perspective view for vision-based 3d semantic occupancy prediction,","venue":null,"work_id":"070082a8-35e9-4571-8bab-8e7f5e192eb0","year":2023},"citing_paper":{"arxiv_id":"2411.14169","last_updated":"2024-11-21T14:27:15Z","snapshot_observed_at":"2026-08-16T11:14:18.409392Z","submitted_at":"2024-11-21T14:27:15Z","title":"Spatiotemporal Decoupling for Efficient Vision-Based Occupancy Forecasting","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-12T15:32:47.334173Z"},"links":{"citing_paper":"/paper/2411.14169"},"observation_digest":"sha256:efcb5025b5eacd14300b06425e10a964049bf377c7e46c2210df9ba02ca3ee1f","observation_id":"d1b76671-acec-4f60-ab64-08d61c12f981","resolution":{"observed_at":"2026-08-12T15:32:48.100043Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2401.06994","last_updated":"2024-01-13T06:43:25Z","snapshot_observed_at":"2026-08-18T12:34:55.140092Z","submitted_at":"2024-01-13T06:43:25Z","title":"UniVision: A Unified Framework for Vision-Centric 3D Perception","version":1},"cited_work":{"arxiv_id":"2401.06994","doi":null,"metadata_source":"pith","pith_arxiv_id":"2401.06994","snapshot_observed_at":"2026-08-12T15:32:47.653971Z","title":"UniVision: A Unified Framework for Vision-Centric 3D Perception","venue":"cs.CV","work_id":"c52b3abe-ff01-4064-98ed-aa95139eedce","year":2024},"citing_paper":{"arxiv_id":"2411.14169","last_updated":"2024-11-21T14:27:15Z","snapshot_observed_at":"2026-08-16T11:14:18.409392Z","submitted_at":"2024-11-21T14:27:15Z","title":"Spatiotemporal Decoupling for Efficient Vision-Based Occupancy Forecasting","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-12T15:32:47.338048Z"},"links":{"cited_paper":"/paper/2401.06994","citing_paper":"/paper/2411.14169"},"observation_digest":"sha256:eaecaf09d3ac61c913de85080796226e39f569987ab75262502bbae91eb8faa7","observation_id":"b0540709-bc74-4511-89ed-23c7b9fc5441","resolution":{"observed_at":"2026-08-12T15:32:47.657378Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T15:32:48.080698Z","title":"Selfocc: Self- supervised vision-based 3d occupancy prediction,","venue":null,"work_id":"754fc44d-761b-4942-b6cd-a49e93632691","year":2024},"citing_paper":{"arxiv_id":"2411.14169","last_updated":"2024-11-21T14:27:15Z","snapshot_observed_at":"2026-08-16T11:14:18.409392Z","submitted_at":"2024-11-21T14:27:15Z","title":"Spatiotemporal Decoupling for Efficient Vision-Based Occupancy Forecasting","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-12T15:32:47.342408Z"},"links":{"citing_paper":"/paper/2411.14169"},"observation_digest":"sha256:dabbc2f2dd5d3dc996b7b76d421fc19e908673f7d2fbad8ee499e1850822a34e","observation_id":"77361583-cf10-4faf-af81-19a7aea67e05","resolution":{"observed_at":"2026-08-12T15:32:48.085478Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T15:32:48.066804Z","title":"Point cloud forecasting as a proxy for 4d occupancy forecasting,","venue":null,"work_id":"1fd41da0-d9fb-4eb9-8cfb-f0ac7b66b79f","year":2023},"citing_paper":{"arxiv_id":"2411.14169","last_updated":"2024-11-21T14:27:15Z","snapshot_observed_at":"2026-08-16T11:14:18.409392Z","submitted_at":"2024-11-21T14:27:15Z","title":"Spatiotemporal Decoupling for Efficient Vision-Based Occupancy Forecasting","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-12T15:32:47.346145Z"},"links":{"citing_paper":"/paper/2411.14169"},"observation_digest":"sha256:d219daa729a46516aaa55e61034167c91f65281467042e09adf4455fa7ab677d","observation_id":"8b4704f1-e30c-4460-97cb-1b6010a83457","resolution":{"observed_at":"2026-08-12T15:32:48.071179Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T15:32:48.052755Z","title":"Fiery: Future instance prediction in bird’s- eye view from surround monocular cameras,","venue":null,"work_id":"0080d7dd-3353-4946-b6e2-7342c6f385e5","year":2021},"citing_paper":{"arxiv_id":"2411.14169","last_updated":"2024-11-21T14:27:15Z","snapshot_observed_at":"2026-08-16T11:14:18.409392Z","submitted_at":"2024-11-21T14:27:15Z","title":"Spatiotemporal Decoupling for Efficient Vision-Based Occupancy Forecasting","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-12T15:32:47.350850Z"},"links":{"citing_paper":"/paper/2411.14169"},"observation_digest":"sha256:467bc843b1497f9fe2fedf717a532828cb40e1d439ea298dcd8b2e116959015e","observation_id":"53c91146-c23d-489b-a9bb-e9bd5225c775","resolution":{"observed_at":"2026-08-12T15:32:48.056962Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T15:32:48.039400Z","title":"Stretchbev: Stretching future instance prediction spatially and temporally,","venue":null,"work_id":"981080db-fef4-4529-9524-38f0ca19f66d","year":2022},"citing_paper":{"arxiv_id":"2411.14169","last_updated":"2024-11-21T14:27:15Z","snapshot_observed_at":"2026-08-16T11:14:18.409392Z","submitted_at":"2024-11-21T14:27:15Z","title":"Spatiotemporal Decoupling for Efficient Vision-Based Occupancy Forecasting","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-12T15:32:47.355081Z"},"links":{"citing_paper":"/paper/2411.14169"},"observation_digest":"sha256:094c801318272f0862c8070ab2f9d9f8c42b9b956767a01ce04fccc166391915","observation_id":"8e2e5854-e2ec-43f4-bb7a-75e9b9811088","resolution":{"observed_at":"2026-08-12T15:32:48.043986Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2205.09743","last_updated":"2022-05-19T17:55:35Z","snapshot_observed_at":"2026-08-16T16:59:06.184750Z","submitted_at":"2022-05-19T17:55:35Z","title":"BEVerse: Unified Perception and Prediction in Birds-Eye-View for Vision-Centric Autonomous Driving","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2205.09743","snapshot_observed_at":"2026-08-12T15:32:47.359044Z","title":"Beverse: Unified perception and prediction in birds-eye-view for vision-centric autonomous driving,","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2411.14169","last_updated":"2024-11-21T14:27:15Z","snapshot_observed_at":"2026-08-16T11:14:18.409392Z","submitted_at":"2024-11-21T14:27:15Z","title":"Spatiotemporal Decoupling for Efficient Vision-Based Occupancy Forecasting","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-12T15:32:47.359044Z"},"links":{"cited_paper":"/paper/2205.09743","citing_paper":"/paper/2411.14169"},"observation_digest":"sha256:16ca9610cc334c3247f9f8242aef1fa89caeb3c83bdd967531c6d1a6f7d6d12b","observation_id":"e1c0e668-104f-4bf5-869b-c1c0e7c34e8f","resolution":{"observed_at":"2026-08-12T15:32:47.359044Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T15:32:48.025515Z","title":"Powerbev: a powerful yet lightweight framework for instance pre- diction in bird’s-eye view,","venue":null,"work_id":"148e781a-2fa6-4eab-aacd-f3fcc5d24831","year":2023},"citing_paper":{"arxiv_id":"2411.14169","last_updated":"2024-11-21T14:27:15Z","snapshot_observed_at":"2026-08-16T11:14:18.409392Z","submitted_at":"2024-11-21T14:27:15Z","title":"Spatiotemporal Decoupling for Efficient Vision-Based Occupancy Forecasting","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-12T15:32:47.364167Z"},"links":{"citing_paper":"/paper/2411.14169"},"observation_digest":"sha256:eef5f2491780ca37d2315aa8b5cdb29b95b3284658cd24754b87c6842b7dde56","observation_id":"bbf1f3a3-71fa-4ac5-9ede-45f77fd713c0","resolution":{"observed_at":"2026-08-12T15:32:48.030298Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T15:32:48.013541Z","title":"Cam4docc: Benchmark for camera-only 4d occupancy forecasting in autonomous driving applications,","venue":null,"work_id":"04fae88c-2d2f-49e2-a682-828f6da4f083","year":2024},"citing_paper":{"arxiv_id":"2411.14169","last_updated":"2024-11-21T14:27:15Z","snapshot_observed_at":"2026-08-16T11:14:18.409392Z","submitted_at":"2024-11-21T14:27:15Z","title":"Spatiotemporal Decoupling for Efficient Vision-Based Occupancy Forecasting","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-12T15:32:47.367421Z"},"links":{"citing_paper":"/paper/2411.14169"},"observation_digest":"sha256:5ba278d02cc0c3489407a86c006ed89898d26e76a118f100c071607b713ae7d6","observation_id":"b74138f2-3edb-4cfe-bf88-651f0346d006","resolution":{"observed_at":"2026-08-12T15:32:48.017388Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2310.11239","last_updated":"2024-09-10T13:28:58Z","snapshot_observed_at":"2026-08-16T14:51:23.579523Z","submitted_at":"2023-10-17T13:08:24Z","title":"LiDAR-based 4D Occupancy Completion and Forecasting","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2310.11239","snapshot_observed_at":"2026-08-12T15:32:47.371082Z","title":"Lidar- based 4d occupancy completion and forecasting,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2411.14169","last_updated":"2024-11-21T14:27:15Z","snapshot_observed_at":"2026-08-16T11:14:18.409392Z","submitted_at":"2024-11-21T14:27:15Z","title":"Spatiotemporal Decoupling for Efficient Vision-Based Occupancy Forecasting","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-12T15:32:47.371082Z"},"links":{"cited_paper":"/paper/2310.11239","citing_paper":"/paper/2411.14169"},"observation_digest":"sha256:843cea15942514373fad70a5d7d4e2dacd8afbc02d9fd19d9615f13017474fb7","observation_id":"4edcee08-3033-489e-a079-68d376116661","resolution":{"observed_at":"2026-08-12T15:32:47.371082Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T15:32:47.374735Z","title":"Surroundocc: Multi-camera 3d occupancy prediction for autonomous driving,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2411.14169","last_updated":"2024-11-21T14:27:15Z","snapshot_observed_at":"2026-08-16T11:14:18.409392Z","submitted_at":"2024-11-21T14:27:15Z","title":"Spatiotemporal Decoupling for Efficient Vision-Based Occupancy Forecasting","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-12T15:32:47.374735Z"},"links":{"citing_paper":"/paper/2411.14169"},"observation_digest":"sha256:89756abc21a3c6b9d9e49ed2ef9257deac4708bc86d59fb02150fd3aec10208b","observation_id":"c9f0c4f7-6362-4880-9d41-c6d0d83a38fa","resolution":{"observed_at":"2026-08-12T15:32:47.374735Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2306.09117","last_updated":"2023-06-15T13:23:57Z","snapshot_observed_at":"2026-08-16T15:23:40.421909Z","submitted_at":"2023-06-15T13:23:57Z","title":"UniOcc: Unifying Vision-Centric 3D Occupancy Prediction with Geometric and Semantic Rendering","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2306.09117","snapshot_observed_at":"2026-08-12T15:32:47.378279Z","title":"Uniocc: Unifying vision-centric 3d occupancy prediction with geometric and semantic rendering,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2411.14169","last_updated":"2024-11-21T14:27:15Z","snapshot_observed_at":"2026-08-16T11:14:18.409392Z","submitted_at":"2024-11-21T14:27:15Z","title":"Spatiotemporal Decoupling for Efficient Vision-Based Occupancy Forecasting","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-12T15:32:47.378279Z"},"links":{"cited_paper":"/paper/2306.09117","citing_paper":"/paper/2411.14169"},"observation_digest":"sha256:0c38fe3772952a11626810a7fef8db072deeab6784f994d2c81aebadb59dc9c4","observation_id":"6be650c7-27bf-4108-add8-3a0acea9d373","resolution":{"observed_at":"2026-08-12T15:32:47.378279Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2402.18140","last_updated":"2024-02-28T08:03:34Z","snapshot_observed_at":"2026-08-16T18:13:29.672838Z","submitted_at":"2024-02-28T08:03:34Z","title":"OccTransformer: Improving BEVFormer for 3D camera-only occupancy prediction","version":1},"cited_work":{"arxiv_id":"2402.18140","doi":null,"metadata_source":"pith","pith_arxiv_id":"2402.18140","snapshot_observed_at":"2026-08-12T15:32:47.605537Z","title":"OccTransformer: Improving BEVFormer for 3D camera-only occupancy prediction","venue":"cs.CV","work_id":"efbd921c-2fb9-40ea-b4ee-c0dfed841a8e","year":2024},"citing_paper":{"arxiv_id":"2411.14169","last_updated":"2024-11-21T14:27:15Z","snapshot_observed_at":"2026-08-16T11:14:18.409392Z","submitted_at":"2024-11-21T14:27:15Z","title":"Spatiotemporal Decoupling for Efficient Vision-Based Occupancy Forecasting","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-12T15:32:47.382029Z"},"links":{"cited_paper":"/paper/2402.18140","citing_paper":"/paper/2411.14169"},"observation_digest":"sha256:e6e411d0cf5f1561cbc18ca36c1c9d1faab2ba18778d89731db3bae830544df2","observation_id":"66315e7f-0155-4619-ae25-e7f3bae0a108","resolution":{"observed_at":"2026-08-12T15:32:47.609983Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T15:32:47.386459Z","title":"nuscenes: A multimodal dataset for autonomous driving,","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2411.14169","last_updated":"2024-11-21T14:27:15Z","snapshot_observed_at":"2026-08-16T11:14:18.409392Z","submitted_at":"2024-11-21T14:27:15Z","title":"Spatiotemporal Decoupling for Efficient Vision-Based Occupancy Forecasting","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-12T15:32:47.386459Z"},"links":{"citing_paper":"/paper/2411.14169"},"observation_digest":"sha256:a610325c560ecfa5b11ec9f4cb18d0ee9ad260454b3e7966ab50ff6dad6ec684","observation_id":"b9c06948-281d-401c-ba0a-d4f721221958","resolution":{"observed_at":"2026-08-12T15:32:47.386459Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T15:32:47.983605Z","title":"Lyft level 5 perception dataset 2020,","venue":null,"work_id":"8fb51693-8372-4e89-9269-8c3ca802b362","year":2020},"citing_paper":{"arxiv_id":"2411.14169","last_updated":"2024-11-21T14:27:15Z","snapshot_observed_at":"2026-08-16T11:14:18.409392Z","submitted_at":"2024-11-21T14:27:15Z","title":"Spatiotemporal Decoupling for Efficient Vision-Based Occupancy Forecasting","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-12T15:32:47.390510Z"},"links":{"citing_paper":"/paper/2411.14169"},"observation_digest":"sha256:d1bb9a3aea322fe614ae652f7a52886a73e7bb2bdc87309b6f420f8d3d42e769","observation_id":"9dd517f9-b526-46f2-a5ab-a6da9b7d8b76","resolution":{"observed_at":"2026-08-12T15:32:47.987604Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T15:32:47.394461Z","title":"Attention is all you need,","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2411.14169","last_updated":"2024-11-21T14:27:15Z","snapshot_observed_at":"2026-08-16T11:14:18.409392Z","submitted_at":"2024-11-21T14:27:15Z","title":"Spatiotemporal Decoupling for Efficient Vision-Based Occupancy Forecasting","version":1},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-12T15:32:47.394461Z"},"links":{"citing_paper":"/paper/2411.14169"},"observation_digest":"sha256:b6dd0e875bc3fc4b94a75a990bc0f92e3dd3fd9f1c7e9abfe660b741fada89f1","observation_id":"0ce5f56c-b18c-478f-964a-d3951c1ee42f","resolution":{"observed_at":"2026-08-12T15:32:47.394461Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T15:32:47.398188Z","title":"Occ3d: A large-scale 3d occupancy prediction benchmark for autonomous driving,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2411.14169","last_updated":"2024-11-21T14:27:15Z","snapshot_observed_at":"2026-08-16T11:14:18.409392Z","submitted_at":"2024-11-21T14:27:15Z","title":"Spatiotemporal Decoupling for Efficient Vision-Based Occupancy Forecasting","version":1},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-12T15:32:47.398188Z"},"links":{"citing_paper":"/paper/2411.14169"},"observation_digest":"sha256:bfb434d412a934e7deaa3611e759037b8e20911caa581dbf544aa15b6682c81c","observation_id":"8d3ba5ad-a8a3-4016-ab42-40125af21231","resolution":{"observed_at":"2026-08-12T15:32:47.398188Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T15:32:47.951715Z","title":"Bevformer: Learning bird’s-eye-view representation from multi-camera images via spatiotemporal transformers,","venue":null,"work_id":"249e28a0-b39b-456b-b7b3-482c125735bf","year":2022},"citing_paper":{"arxiv_id":"2411.14169","last_updated":"2024-11-21T14:27:15Z","snapshot_observed_at":"2026-08-16T11:14:18.409392Z","submitted_at":"2024-11-21T14:27:15Z","title":"Spatiotemporal Decoupling for Efficient Vision-Based Occupancy Forecasting","version":1},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-12T15:32:47.402619Z"},"links":{"citing_paper":"/paper/2411.14169"},"observation_digest":"sha256:78823757a9c15d77c9d0b8ecd1ace240079a6af9c49baa8462ddfa675811a286","observation_id":"2e099d6b-5456-43dc-933d-a1bebf5da3ac","resolution":{"observed_at":"2026-08-12T15:32:47.956527Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T15:32:47.940545Z","title":"Bevdepth: Acquisition of reliable depth for multi-view 3d object detection,","venue":null,"work_id":"e35fcbfb-e0bb-4b62-b71f-bd3640bca8ee","year":2023},"citing_paper":{"arxiv_id":"2411.14169","last_updated":"2024-11-21T14:27:15Z","snapshot_observed_at":"2026-08-16T11:14:18.409392Z","submitted_at":"2024-11-21T14:27:15Z","title":"Spatiotemporal Decoupling for Efficient Vision-Based Occupancy Forecasting","version":1},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-12T15:32:47.407902Z"},"links":{"citing_paper":"/paper/2411.14169"},"observation_digest":"sha256:ee746f79a50487bb811f6d34fcb52e04623747afd917eda0d8278701d0d36eb3","observation_id":"1438c508-9c1f-4bf2-8518-79a94c2cbf3d","resolution":{"observed_at":"2026-08-12T15:32:47.944050Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T15:32:47.930167Z","title":"Bevfusion: Multi-task multi-sensor fusion with unified bird’s- eye view representation,","venue":null,"work_id":"fbd148d3-88ea-4339-8370-3f4142f7f0d7","year":2023},"citing_paper":{"arxiv_id":"2411.14169","last_updated":"2024-11-21T14:27:15Z","snapshot_observed_at":"2026-08-16T11:14:18.409392Z","submitted_at":"2024-11-21T14:27:15Z","title":"Spatiotemporal Decoupling for Efficient Vision-Based Occupancy Forecasting","version":1},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-12T15:32:47.412190Z"},"links":{"citing_paper":"/paper/2411.14169"},"observation_digest":"sha256:15594bb68c9e4596733153a36cb9a7291bf948c6775afe326fce411234a4508c","observation_id":"91069a47-1937-4c5c-a039-07e5493ee7dc","resolution":{"observed_at":"2026-08-12T15:32:47.933604Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T15:32:47.918332Z","title":"Multi-modal hierarchical transformer for occupancy flow field prediction in autonomous driving,","venue":null,"work_id":"e1d5b18e-e961-4a8d-9b50-1d5a43b8087c","year":2023},"citing_paper":{"arxiv_id":"2411.14169","last_updated":"2024-11-21T14:27:15Z","snapshot_observed_at":"2026-08-16T11:14:18.409392Z","submitted_at":"2024-11-21T14:27:15Z","title":"Spatiotemporal Decoupling for Efficient Vision-Based Occupancy Forecasting","version":1},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-08-12T15:32:47.416769Z"},"links":{"citing_paper":"/paper/2411.14169"},"observation_digest":"sha256:3bddafb8821db34ea81bfad5c67e3ce001f5abddbe991d5cfaada3ac10a125b5","observation_id":"a7de4b5e-c3c7-4956-8e3f-adebe2f85b2f","resolution":{"observed_at":"2026-08-12T15:32:47.922546Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T15:32:47.420875Z","title":"Occupancy flow fields for motion forecasting in autonomous driving,","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2411.14169","last_updated":"2024-11-21T14:27:15Z","snapshot_observed_at":"2026-08-16T11:14:18.409392Z","submitted_at":"2024-11-21T14:27:15Z","title":"Spatiotemporal Decoupling for Efficient Vision-Based Occupancy Forecasting","version":1},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-08-12T15:32:47.420875Z"},"links":{"citing_paper":"/paper/2411.14169"},"observation_digest":"sha256:d8bd98e274a501afcae3246fe35b08719a1e280d2e6b968dc6602049ee15e2dc","observation_id":"9396295c-4231-4b10-a59f-8816df6d87ab","resolution":{"observed_at":"2026-08-12T15:32:47.420875Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T15:32:47.895381Z","title":"Motionnet: Joint perception and motion prediction for autonomous driving based on bird’s eye view maps,","venue":null,"work_id":"f0fef657-1b04-45a9-9ab6-efac7692b7e0","year":2020},"citing_paper":{"arxiv_id":"2411.14169","last_updated":"2024-11-21T14:27:15Z","snapshot_observed_at":"2026-08-16T11:14:18.409392Z","submitted_at":"2024-11-21T14:27:15Z","title":"Spatiotemporal Decoupling for Efficient Vision-Based Occupancy Forecasting","version":1},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-08-12T15:32:47.425380Z"},"links":{"citing_paper":"/paper/2411.14169"},"observation_digest":"sha256:c8f5ad2ea9a14fb2adea8ee02d56db412d50d60cc0ecb2ce5a6b162db6678f07","observation_id":"309f71fe-fbb8-441d-92b4-342648238963","resolution":{"observed_at":"2026-08-12T15:32:47.899887Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T15:32:47.881833Z","title":"Mp3: A unified model to map, perceive, predict and plan,","venue":null,"work_id":"d74ad28c-90c8-40b0-8125-f88ede250c16","year":2021},"citing_paper":{"arxiv_id":"2411.14169","last_updated":"2024-11-21T14:27:15Z","snapshot_observed_at":"2026-08-16T11:14:18.409392Z","submitted_at":"2024-11-21T14:27:15Z","title":"Spatiotemporal Decoupling for Efficient Vision-Based Occupancy Forecasting","version":1},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-08-12T15:32:47.429804Z"},"links":{"citing_paper":"/paper/2411.14169"},"observation_digest":"sha256:40e10f70897afe35959fea1d8cc7e4565a1e8ffaa6b7f83d0121c3bbff967b4a","observation_id":"3309eb1d-7308-45fb-b653-53c5beacea6b","resolution":{"observed_at":"2026-08-12T15:32:47.886455Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T15:32:47.868168Z","title":"Monet: Motion-based point cloud prediction network,","venue":null,"work_id":"bd92545f-863c-4725-8c99-d77ceba9dda6","year":2021},"citing_paper":{"arxiv_id":"2411.14169","last_updated":"2024-11-21T14:27:15Z","snapshot_observed_at":"2026-08-16T11:14:18.409392Z","submitted_at":"2024-11-21T14:27:15Z","title":"Spatiotemporal Decoupling for Efficient Vision-Based Occupancy Forecasting","version":1},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-08-12T15:32:47.434210Z"},"links":{"citing_paper":"/paper/2411.14169"},"observation_digest":"sha256:facfb653997f40c05b283d2e336ef0287dd8986ba836e60fe766266b0c4638d5","observation_id":"2be51fe1-df04-4eb8-bfa8-ff16d7275de9","resolution":{"observed_at":"2026-08-12T15:32:47.872813Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T15:32:47.740202Z","title":"Pcpnet: An efficient and semantic-enhanced transformer network for point cloud prediction,","venue":null,"work_id":"f0da1747-990b-4cc9-8a70-ce510d9e6841","year":2023},"citing_paper":{"arxiv_id":"2411.14169","last_updated":"2024-11-21T14:27:15Z","snapshot_observed_at":"2026-08-16T11:14:18.409392Z","submitted_at":"2024-11-21T14:27:15Z","title":"Spatiotemporal Decoupling for Efficient Vision-Based Occupancy Forecasting","version":1},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-08-12T15:32:47.438514Z"},"links":{"citing_paper":"/paper/2411.14169"},"observation_digest":"sha256:891fa1b70b0c4b13e38ca314fd34e4890ef80dc8bde0143e5a06b1bec7dd2504","observation_id":"e5e63fe6-adb0-44fd-8092-04ecff60f448","resolution":{"observed_at":"2026-08-12T15:32:47.859210Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2401.17399","last_updated":"2024-01-30T19:31:54Z","snapshot_observed_at":"2026-08-16T14:23:06.248586Z","submitted_at":"2024-01-30T19:31:54Z","title":"ATPPNet: Attention based Temporal Point cloud Prediction Network","version":1},"cited_work":{"arxiv_id":"2401.17399","doi":null,"metadata_source":"pith","pith_arxiv_id":"2401.17399","snapshot_observed_at":"2026-08-12T15:32:47.583720Z","title":"ATPPNet: Attention based Temporal Point cloud Prediction Network","venue":"cs.RO","work_id":"1b08a39c-c5a9-45a3-a862-de5e27cd8407","year":2024},"citing_paper":{"arxiv_id":"2411.14169","last_updated":"2024-11-21T14:27:15Z","snapshot_observed_at":"2026-08-16T11:14:18.409392Z","submitted_at":"2024-11-21T14:27:15Z","title":"Spatiotemporal Decoupling for Efficient Vision-Based Occupancy Forecasting","version":1},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-08-12T15:32:47.442619Z"},"links":{"cited_paper":"/paper/2401.17399","citing_paper":"/paper/2411.14169"},"observation_digest":"sha256:c8c99aa964b8fdd96ade249a01a8bd251eb3b789a5e6327b44cf0a882b090ea6","observation_id":"3d4e9868-c702-4fc8-b80d-9d6799dd1021","resolution":{"observed_at":"2026-08-12T15:32:47.590738Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T15:32:47.728064Z","title":"Self-supervised point cloud prediction using 3d spatio-temporal convolutional net- works,","venue":null,"work_id":"2f0ce0ec-124a-4c0f-a234-f319e7f1b3a6","year":2022},"citing_paper":{"arxiv_id":"2411.14169","last_updated":"2024-11-21T14:27:15Z","snapshot_observed_at":"2026-08-16T11:14:18.409392Z","submitted_at":"2024-11-21T14:27:15Z","title":"Spatiotemporal Decoupling for Efficient Vision-Based Occupancy Forecasting","version":1},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-08-12T15:32:47.447238Z"},"links":{"citing_paper":"/paper/2411.14169"},"observation_digest":"sha256:7fccbc4e5865284bbf46b40a05491aa61f4f969ec135105b791fda96037c526a","observation_id":"e15a6c4d-681f-469a-bb1b-4547c962e703","resolution":{"observed_at":"2026-08-12T15:32:47.732220Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1910.08287","last_updated":"2019-11-24T12:26:29Z","snapshot_observed_at":"2026-08-16T18:58:40.228932Z","submitted_at":"2019-10-18T07:21:37Z","title":"PointRNN: Point Recurrent Neural Network for Moving Point Cloud Processing","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1910.08287","snapshot_observed_at":"2026-08-12T15:32:47.451190Z","title":"Pointrnn: Point recurrent neural network for moving point cloud processing,","venue":null,"work_id":null,"year":1910},"citing_paper":{"arxiv_id":"2411.14169","last_updated":"2024-11-21T14:27:15Z","snapshot_observed_at":"2026-08-16T11:14:18.409392Z","submitted_at":"2024-11-21T14:27:15Z","title":"Spatiotemporal Decoupling for Efficient Vision-Based Occupancy Forecasting","version":1},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-08-12T15:32:47.451190Z"},"links":{"cited_paper":"/paper/1910.08287","citing_paper":"/paper/2411.14169"},"observation_digest":"sha256:061d77fafe198a104cc6b56011be11eb24fae5e092e6fe0e2fea446312f52bf5","observation_id":"6b3320ad-339b-43cf-bd53-93e5d60afe05","resolution":{"observed_at":"2026-08-12T15:32:47.451190Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2311.16038","last_updated":"2023-11-27T17:59:41Z","snapshot_observed_at":"2026-08-16T14:39:57.136408Z","submitted_at":"2023-11-27T17:59:41Z","title":"OccWorld: Learning a 3D Occupancy World Model for Autonomous Driving","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2311.16038","snapshot_observed_at":"2026-08-12T15:32:47.455530Z","title":"Occworld: Learning a 3d occupancy world model for autonomous driving,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2411.14169","last_updated":"2024-11-21T14:27:15Z","snapshot_observed_at":"2026-08-16T11:14:18.409392Z","submitted_at":"2024-11-21T14:27:15Z","title":"Spatiotemporal Decoupling for Efficient Vision-Based Occupancy Forecasting","version":1},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-08-12T15:32:47.455530Z"},"links":{"cited_paper":"/paper/2311.16038","citing_paper":"/paper/2411.14169"},"observation_digest":"sha256:dcc4824d4f8c5d0044be761634426290f4c011f2a89ef35437670360284f3f58","observation_id":"aa78ec5e-3509-45c8-9679-c53bdeccfcd4","resolution":{"observed_at":"2026-08-12T15:32:47.455530Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2405.20337","last_updated":"2024-05-30T17:59:42Z","snapshot_observed_at":"2026-08-16T13:47:37.874188Z","submitted_at":"2024-05-30T17:59:42Z","title":"OccSora: 4D Occupancy Generation Models as World Simulators for Autonomous Driving","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2405.20337","snapshot_observed_at":"2026-08-12T15:32:47.459743Z","title":"Occsora: 4d occupancy generation models as world simulators for autonomous driving,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2411.14169","last_updated":"2024-11-21T14:27:15Z","snapshot_observed_at":"2026-08-16T11:14:18.409392Z","submitted_at":"2024-11-21T14:27:15Z","title":"Spatiotemporal Decoupling for Efficient Vision-Based Occupancy Forecasting","version":1},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-08-12T15:32:47.459743Z"},"links":{"cited_paper":"/paper/2405.20337","citing_paper":"/paper/2411.14169"},"observation_digest":"sha256:08a0daf178df20be103a6f95085abfd706a74b5afbed96f8a947b907a19e4c4c","observation_id":"6277ad01-75d3-4762-83df-c8e66b907c11","resolution":{"observed_at":"2026-08-12T15:32:47.459743Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T15:32:47.716998Z","title":"Lift, splat, shoot: Encoding images from arbitrary camera rigs by implicitly unprojecting to 3d,","venue":null,"work_id":"7b72aa43-7131-4ad9-849f-d5691fb55dae","year":2020},"citing_paper":{"arxiv_id":"2411.14169","last_updated":"2024-11-21T14:27:15Z","snapshot_observed_at":"2026-08-16T11:14:18.409392Z","submitted_at":"2024-11-21T14:27:15Z","title":"Spatiotemporal Decoupling for Efficient Vision-Based Occupancy Forecasting","version":1},"reference_index":36,"source":"pdf_text","source_observed_at":"2026-08-12T15:32:47.464171Z"},"links":{"citing_paper":"/paper/2411.14169"},"observation_digest":"sha256:480aae1af3580cdda4761b4ec242f35e959809a1bf92c24a02a78e61bc2a64c5","observation_id":"23507d51-4c78-4669-ac56-b92ab23c1637","resolution":{"observed_at":"2026-08-12T15:32:47.720794Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T15:32:47.468292Z","title":"Deep residual learning for image recognition,","venue":null,"work_id":null,"year":2016},"citing_paper":{"arxiv_id":"2411.14169","last_updated":"2024-11-21T14:27:15Z","snapshot_observed_at":"2026-08-16T11:14:18.409392Z","submitted_at":"2024-11-21T14:27:15Z","title":"Spatiotemporal Decoupling for Efficient Vision-Based Occupancy Forecasting","version":1},"reference_index":37,"source":"pdf_text","source_observed_at":"2026-08-12T15:32:47.468292Z"},"links":{"citing_paper":"/paper/2411.14169"},"observation_digest":"sha256:3cfd7a205f8d57e92a9947c056abca326915513c47bba3ef48e191f5f61dae17","observation_id":"3b403d24-ca52-4fd1-8004-595c1856d252","resolution":{"observed_at":"2026-08-12T15:32:47.468292Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T15:32:47.696472Z","title":"Video panoptic seg- mentation,","venue":null,"work_id":"25f7778a-7963-45eb-8372-08fc2f9abb2c","year":2020},"citing_paper":{"arxiv_id":"2411.14169","last_updated":"2024-11-21T14:27:15Z","snapshot_observed_at":"2026-08-16T11:14:18.409392Z","submitted_at":"2024-11-21T14:27:15Z","title":"Spatiotemporal Decoupling for Efficient Vision-Based Occupancy Forecasting","version":1},"reference_index":38,"source":"pdf_text","source_observed_at":"2026-08-12T15:32:47.472813Z"},"links":{"citing_paper":"/paper/2411.14169"},"observation_digest":"sha256:210e3314f1baeaf01447a1419f0ee067369a445916c342ec91dc0cd3061e494a","observation_id":"bcc8d575-b145-44a5-8a69-b359c95c60f7","resolution":{"observed_at":"2026-08-12T15:32:47.700371Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T15:32:47.685823Z","title":"Self-training with noisy student improves imagenet classification,","venue":null,"work_id":"1fa43315-7426-471b-8b3f-b5bec44b0f4d","year":2020},"citing_paper":{"arxiv_id":"2411.14169","last_updated":"2024-11-21T14:27:15Z","snapshot_observed_at":"2026-08-16T11:14:18.409392Z","submitted_at":"2024-11-21T14:27:15Z","title":"Spatiotemporal Decoupling for Efficient Vision-Based Occupancy Forecasting","version":1},"reference_index":39,"source":"pdf_text","source_observed_at":"2026-08-12T15:32:47.477119Z"},"links":{"citing_paper":"/paper/2411.14169"},"observation_digest":"sha256:57b755fd975312dbcd52740cf12c915f3d20894e918030031386c56cfa75dafa","observation_id":"bee717ee-5639-41ce-a2e8-8f457fb5954d","resolution":{"observed_at":"2026-08-12T15:32:47.689419Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1412.6980","last_updated":"2017-01-30T01:27:54Z","snapshot_observed_at":"2026-08-17T19:26:44.032537Z","submitted_at":"2014-12-22T13:54:29Z","title":"Adam: A Method for Stochastic Optimization","version":9},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1412.6980","snapshot_observed_at":"2026-08-12T15:32:47.482119Z","title":"Adam: A method for stochastic optimiza- tion,","venue":null,"work_id":null,"year":2014},"citing_paper":{"arxiv_id":"2411.14169","last_updated":"2024-11-21T14:27:15Z","snapshot_observed_at":"2026-08-16T11:14:18.409392Z","submitted_at":"2024-11-21T14:27:15Z","title":"Spatiotemporal Decoupling for Efficient Vision-Based Occupancy Forecasting","version":1},"reference_index":40,"source":"pdf_text","source_observed_at":"2026-08-12T15:32:47.482119Z"},"links":{"cited_paper":"/paper/1412.6980","citing_paper":"/paper/2411.14169"},"observation_digest":"sha256:b280f1356dec58c85a5cfafdf11781b0014c8daa4576b4d9cfa342f63b3b4dfc","observation_id":"3604dc8e-7046-46b0-8f12-250a9da37077","resolution":{"observed_at":"2026-08-12T15:32:47.482119Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T15:32:47.674071Z","title":"IV of the main text","venue":null,"work_id":"caea28a7-2eb7-435a-9953-9999c1af0839","year":null},"citing_paper":{"arxiv_id":"2411.14169","last_updated":"2024-11-21T14:27:15Z","snapshot_observed_at":"2026-08-16T11:14:18.409392Z","submitted_at":"2024-11-21T14:27:15Z","title":"Spatiotemporal Decoupling for Efficient Vision-Based Occupancy Forecasting","version":1},"reference_index":41,"source":"pdf_text","source_observed_at":"2026-08-12T15:32:47.486496Z"},"links":{"citing_paper":"/paper/2411.14169"},"observation_digest":"sha256:214e0b23f0889a24117be6c697ca00d66d7e9498a713c852dd2cae4e5d4034d6","observation_id":"b39d30bf-d186-46b1-936a-298a45e79380","resolution":{"observed_at":"2026-08-12T15:32:47.677676Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T15:32:47.664139Z","title":"As shown in Fig","venue":null,"work_id":"b528a579-76a2-49bf-abcb-61bd45dbacbe","year":null},"citing_paper":{"arxiv_id":"2411.14169","last_updated":"2024-11-21T14:27:15Z","snapshot_observed_at":"2026-08-16T11:14:18.409392Z","submitted_at":"2024-11-21T14:27:15Z","title":"Spatiotemporal Decoupling for Efficient Vision-Based Occupancy Forecasting","version":1},"reference_index":42,"source":"pdf_text","source_observed_at":"2026-08-12T15:32:47.491471Z"},"links":{"citing_paper":"/paper/2411.14169"},"observation_digest":"sha256:de5a56192dd31af41678a077ad33e8bc4526d1649e95ec8722221f3ceca4aea9","observation_id":"5b78f164-4085-4379-8a3e-8d8addb40139","resolution":{"observed_at":"2026-08-12T15:32:47.667313Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}}],"paper":{"arxiv_id":"2411.14169","last_updated":"2024-11-21T14:27:15Z","latest_version":1,"primary_category":"cs.CV","snapshot_observed_at":"2026-08-16T11:14:18.409392Z","submitted_at":"2024-11-21T14:27:15Z","title":"Spatiotemporal Decoupling for Efficient Vision-Based Occupancy Forecasting"},"reference_resolution":{"displayed":42,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":15,"verified_exact":3,"verified_fuzzy":24},"total_outbound_references":42},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"thesis":"As of 19 August 2026, this Paper Citation Record lists 42 of 42 outbound references and 0 inbound Pith citation observations for arXiv:2411.14169."}