{"as_of":"2026-08-13T02:32:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:8d2dc57bdd17e0595782abfc5ed8968564b5ff2361763e61df528aeca203285b","coverage":[{"denominator":90,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":90,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-11T15:17:38.949058Z","state":"measured"},{"denominator":91,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":91,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-12T06:34:41.77262+00:00","state":"measured"},{"denominator":1,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":1,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-05T06:04:21.354744Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2412.11183","last_updated":"2025-08-22T08:05:31Z","snapshot_observed_at":"2026-08-11T15:10:22.471125Z","submitted_at":"2024-12-15T13:26:51Z","title":"OccScene: Semantic Occupancy-based Cross-task Mutual Learning for 3D Scene Generation","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2412.11183","snapshot_observed_at":"2026-08-05T06:04:21.354744Z","title":"OccScene: Semantic occupancy-based cross-task mutual learning for 3D scene generation.arXiv preprint arXiv:2412.11183, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2509.07996","last_updated":"2026-07-20T17:34:32Z","snapshot_observed_at":"2026-08-07T09:38:31.708978Z","submitted_at":"2025-09-04T17:59:58Z","title":"3D and 4D World Modeling: A Survey","version":4},"reference_index":126,"source":"pdf_text","source_observed_at":"2026-08-05T06:04:21.354744Z"},"links":{"cited_paper":"/paper/2412.11183","citing_paper":"/paper/2509.07996"},"observation_digest":"sha256:5ad72d7d725b772c49bda4a4cf0421b995e53e352b653065f568708b67ed43e3","observation_id":"00d79cd2-c35b-4ebd-b5f3-e81bd3d4c248","resolution":{"observed_at":"2026-08-05T06:04:21.354744Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"links":{"evidence":"/evidence","html":"/paper/2412.11183/citation-record","integrity":"/paper/2412.11183/integrity","json":"/paper/2412.11183/citation-record.json","paper":"/paper/2412.11183"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T15:17:38.619572Z","title":"Semantic scene completion using local deep implicit functions on lidar data,","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2412.11183","last_updated":"2025-08-22T08:05:31Z","snapshot_observed_at":"2026-08-11T15:10:22.471125Z","submitted_at":"2024-12-15T13:26:51Z","title":"OccScene: Semantic Occupancy-based Cross-task Mutual Learning for 3D Scene Generation","version":2},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-11T15:17:38.619572Z"},"links":{"citing_paper":"/paper/2412.11183"},"observation_digest":"sha256:a809f82a22e682d6a5823dd4246eb6d525380c5d7cf56e2935faf49b5f2fe4bf","observation_id":"34ffc061-ebd1-4543-a3f7-de2fc49111f3","resolution":{"observed_at":"2026-08-11T15:17:38.619572Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T15:17:38.624048Z","title":"Kitti-360: A novel dataset and benchmarks for urban scene understanding in 2d and 3d,","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2412.11183","last_updated":"2025-08-22T08:05:31Z","snapshot_observed_at":"2026-08-11T15:10:22.471125Z","submitted_at":"2024-12-15T13:26:51Z","title":"OccScene: Semantic Occupancy-based Cross-task Mutual Learning for 3D Scene Generation","version":2},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-11T15:17:38.624048Z"},"links":{"citing_paper":"/paper/2412.11183"},"observation_digest":"sha256:fc0006c81d8c2256b91a2a8d825315e77e2e8dc111f600e44415bd84020326cd","observation_id":"3f60cfd1-a2e8-4109-9299-4d0fdc5e8afd","resolution":{"observed_at":"2026-08-11T15:17:38.624048Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T15:17:38.628170Z","title":"Anisotropic convolutional neural networks for rgb-d based semantic scene completion,","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2412.11183","last_updated":"2025-08-22T08:05:31Z","snapshot_observed_at":"2026-08-11T15:10:22.471125Z","submitted_at":"2024-12-15T13:26:51Z","title":"OccScene: Semantic Occupancy-based Cross-task Mutual Learning for 3D Scene Generation","version":2},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-11T15:17:38.628170Z"},"links":{"citing_paper":"/paper/2412.11183"},"observation_digest":"sha256:04d36833cfb7bd0eda5d9cf1b410b61222a18950d5f8d69724924b968d5fa701","observation_id":"c5885906-c78a-40a0-9362-cbdd41b4b193","resolution":{"observed_at":"2026-08-11T15:17:38.628170Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T15:17:38.631921Z","title":"From front to rear: 3d semantic scene completion through planar convolution and attention- based network,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2412.11183","last_updated":"2025-08-22T08:05:31Z","snapshot_observed_at":"2026-08-11T15:10:22.471125Z","submitted_at":"2024-12-15T13:26:51Z","title":"OccScene: Semantic Occupancy-based Cross-task Mutual Learning for 3D Scene Generation","version":2},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-11T15:17:38.631921Z"},"links":{"citing_paper":"/paper/2412.11183"},"observation_digest":"sha256:fe06c71203bc809f30805ea409bf6d5440f968a7f41f5f4d5004a2525865b46c","observation_id":"1e9d0d2f-a000-4207-96f8-fa86a2c9ff2a","resolution":{"observed_at":"2026-08-11T15:17:38.631921Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2303.13959","last_updated":"2024-05-06T15:14:22Z","snapshot_observed_at":"2026-08-10T13:55:48.736934Z","submitted_at":"2023-03-24T12:33:44Z","title":"Bridging Stereo Geometry and BEV Representation with Reliable Mutual Interaction for Semantic Scene Completion","version":6},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2303.13959","snapshot_observed_at":"2026-08-11T15:17:38.635467Z","title":"Stereoscene: Bev-assisted stereo matching empow- ers 3d semantic scene completion,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2412.11183","last_updated":"2025-08-22T08:05:31Z","snapshot_observed_at":"2026-08-11T15:10:22.471125Z","submitted_at":"2024-12-15T13:26:51Z","title":"OccScene: Semantic Occupancy-based Cross-task Mutual Learning for 3D Scene Generation","version":2},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-11T15:17:38.635467Z"},"links":{"cited_paper":"/paper/2303.13959","citing_paper":"/paper/2412.11183"},"observation_digest":"sha256:e6a76eaab27c50e0f3a32b704f1d95fb6d6f219af3a58294dcd57be3c041712e","observation_id":"7b2f793c-3625-4aec-81dc-f66ad87390f0","resolution":{"observed_at":"2026-08-11T15:17:38.635467Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T15:17:38.639657Z","title":"Diffusion probabilistic models for 3d point cloud generation,","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2412.11183","last_updated":"2025-08-22T08:05:31Z","snapshot_observed_at":"2026-08-11T15:10:22.471125Z","submitted_at":"2024-12-15T13:26:51Z","title":"OccScene: Semantic Occupancy-based Cross-task Mutual Learning for 3D Scene Generation","version":2},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-11T15:17:38.639657Z"},"links":{"citing_paper":"/paper/2412.11183"},"observation_digest":"sha256:2c818db1cbff22f4b263f9801c9323dc2e930d056282029091c948553e722e82","observation_id":"dfd7cb2a-2349-4b25-bfd8-8152c520418a","resolution":{"observed_at":"2026-08-11T15:17:38.639657Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T15:17:38.643650Z","title":"High- resolution image synthesis with latent diffusion models,","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2412.11183","last_updated":"2025-08-22T08:05:31Z","snapshot_observed_at":"2026-08-11T15:10:22.471125Z","submitted_at":"2024-12-15T13:26:51Z","title":"OccScene: Semantic Occupancy-based Cross-task Mutual Learning for 3D Scene Generation","version":2},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-11T15:17:38.643650Z"},"links":{"citing_paper":"/paper/2412.11183"},"observation_digest":"sha256:f5b36c5f09a6311cb9bc9c93516d75494c69ca00da47fb64a8469f636c4629ec","observation_id":"4077c49f-dc53-4e54-b35e-d70719db641a","resolution":{"observed_at":"2026-08-11T15:17:38.643650Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T15:17:38.647110Z","title":"Conditional diffusion process for inverse halftoning,","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2412.11183","last_updated":"2025-08-22T08:05:31Z","snapshot_observed_at":"2026-08-11T15:10:22.471125Z","submitted_at":"2024-12-15T13:26:51Z","title":"OccScene: Semantic Occupancy-based Cross-task Mutual Learning for 3D Scene Generation","version":2},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-11T15:17:38.647110Z"},"links":{"citing_paper":"/paper/2412.11183"},"observation_digest":"sha256:83cb14111e1eb5af90649203649c511e0b7b4d2020c4bc1d2326b8443bb8a727","observation_id":"6fb0994b-7d52-4505-94ef-1f40c3f9ea4a","resolution":{"observed_at":"2026-08-11T15:17:38.647110Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T15:17:38.650693Z","title":"One at a time: Progressive multi-step volumetric probability learning for reliable 3d scene perception,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2412.11183","last_updated":"2025-08-22T08:05:31Z","snapshot_observed_at":"2026-08-11T15:10:22.471125Z","submitted_at":"2024-12-15T13:26:51Z","title":"OccScene: Semantic Occupancy-based Cross-task Mutual Learning for 3D Scene Generation","version":2},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-11T15:17:38.650693Z"},"links":{"citing_paper":"/paper/2412.11183"},"observation_digest":"sha256:a3d95bd5ac82f0b2184e5ed4ff3763ad7070dd22133ec3641c5cd86019e460bb","observation_id":"3f140ba4-049d-4487-90f0-c530ddf65ec9","resolution":{"observed_at":"2026-08-11T15:17:38.650693Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2308.01661","last_updated":"2023-09-23T06:59:18Z","snapshot_observed_at":"2026-08-10T15:06:41.781578Z","submitted_at":"2023-08-03T09:56:31Z","title":"BEVControl: Accurately Controlling Street-view Elements with Multi-perspective Consistency via BEV Sketch Layout","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2308.01661","snapshot_observed_at":"2026-08-11T15:17:38.654731Z","title":"Bevcontrol: Accu- rately controlling street-view elements with multi-perspective consistency via bev sketch layout,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2412.11183","last_updated":"2025-08-22T08:05:31Z","snapshot_observed_at":"2026-08-11T15:10:22.471125Z","submitted_at":"2024-12-15T13:26:51Z","title":"OccScene: Semantic Occupancy-based Cross-task Mutual Learning for 3D Scene Generation","version":2},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-11T15:17:38.654731Z"},"links":{"cited_paper":"/paper/2308.01661","citing_paper":"/paper/2412.11183"},"observation_digest":"sha256:2285042d8a0bfaf04d79559c41293f786400eb8a2926fe42cc865ac0751bbc69","observation_id":"33c0a65c-d045-46e0-aed8-4b4fdf384d25","resolution":{"observed_at":"2026-08-11T15:17:38.654731Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T15:17:38.659260Z","title":"Street-view image generation from a bird’s-eye view layout,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2412.11183","last_updated":"2025-08-22T08:05:31Z","snapshot_observed_at":"2026-08-11T15:10:22.471125Z","submitted_at":"2024-12-15T13:26:51Z","title":"OccScene: Semantic Occupancy-based Cross-task Mutual Learning for 3D Scene Generation","version":2},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-11T15:17:38.659260Z"},"links":{"citing_paper":"/paper/2412.11183"},"observation_digest":"sha256:a1076aa3fd1bc38bea2937b0a77d6fe7b44dd5d76191598e8381629af90da3b0","observation_id":"14c7401c-bc6a-41cf-97bf-857490768e39","resolution":{"observed_at":"2026-08-11T15:17:38.659260Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2309.09777","last_updated":"2023-11-27T05:09:29Z","snapshot_observed_at":"2026-07-06T16:19:57.322692Z","submitted_at":"2023-09-18T13:58:42Z","title":"DriveDreamer: Towards Real-world-driven World Models for Autonomous Driving","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2309.09777","snapshot_observed_at":"2026-08-11T15:17:38.663353Z","title":"Drivedreamer: Towards real-world-driven world models for autonomous driving,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2412.11183","last_updated":"2025-08-22T08:05:31Z","snapshot_observed_at":"2026-08-11T15:10:22.471125Z","submitted_at":"2024-12-15T13:26:51Z","title":"OccScene: Semantic Occupancy-based Cross-task Mutual Learning for 3D Scene Generation","version":2},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-11T15:17:38.663353Z"},"links":{"cited_paper":"/paper/2309.09777","citing_paper":"/paper/2412.11183"},"observation_digest":"sha256:f5087bffa82f07327be7865448563bee99575b6ca2d6b5eb18ee3651a81018e5","observation_id":"d2627754-3a57-43ec-8f8c-c224e4679e9f","resolution":{"observed_at":"2026-08-11T15:17:38.663353Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1810.10863","last_updated":"2018-10-25T13:17:33Z","snapshot_observed_at":"2026-08-07T09:09:39.188154Z","submitted_at":"2018-10-25T13:17:33Z","title":"GAN Augmentation: Augmenting Training Data using Generative Adversarial Networks","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1810.10863","snapshot_observed_at":"2026-08-11T15:17:38.668391Z","title":"Gan augmentation: Augmenting training data using generative adversarial networks,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2412.11183","last_updated":"2025-08-22T08:05:31Z","snapshot_observed_at":"2026-08-11T15:10:22.471125Z","submitted_at":"2024-12-15T13:26:51Z","title":"OccScene: Semantic Occupancy-based Cross-task Mutual Learning for 3D Scene Generation","version":2},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-11T15:17:38.668391Z"},"links":{"cited_paper":"/paper/1810.10863","citing_paper":"/paper/2412.11183"},"observation_digest":"sha256:975042fb60d0914dd0ec402bb625bdc56bfde0b02619ac4fbc1f55fb2e0804e7","observation_id":"3bb0c5b2-8eb8-4099-a7ea-cfea31e2584a","resolution":{"observed_at":"2026-08-11T15:17:38.668391Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2306.04607","last_updated":"2024-02-17T01:43:45Z","snapshot_observed_at":"2026-08-04T14:22:04.423419Z","submitted_at":"2023-06-07T17:17:58Z","title":"GeoDiffusion: Text-Prompted Geometric Control for Object Detection Data Generation","version":8},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2306.04607","snapshot_observed_at":"2026-08-11T15:17:38.673412Z","title":"Integrating geometric control into text-to-image diffusion models for high-quality de- tection data generation via text prompt,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2412.11183","last_updated":"2025-08-22T08:05:31Z","snapshot_observed_at":"2026-08-11T15:10:22.471125Z","submitted_at":"2024-12-15T13:26:51Z","title":"OccScene: Semantic Occupancy-based Cross-task Mutual Learning for 3D Scene Generation","version":2},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-11T15:17:38.673412Z"},"links":{"cited_paper":"/paper/2306.04607","citing_paper":"/paper/2412.11183"},"observation_digest":"sha256:d4822296bf67a481a7e875b33fa24a622b29367d49ea235f932784621d53f777","observation_id":"c0c66181-cab5-4ca6-a229-74f75dbbba3e","resolution":{"observed_at":"2026-08-11T15:17:38.673412Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T15:17:38.677798Z","title":"Detdiffusion: Synergizing generative and perceptive models for enhanced data generation and perception,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2412.11183","last_updated":"2025-08-22T08:05:31Z","snapshot_observed_at":"2026-08-11T15:10:22.471125Z","submitted_at":"2024-12-15T13:26:51Z","title":"OccScene: Semantic Occupancy-based Cross-task Mutual Learning for 3D Scene Generation","version":2},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-11T15:17:38.677798Z"},"links":{"citing_paper":"/paper/2412.11183"},"observation_digest":"sha256:fd747816903d6073adbeb9e1195a2f9a7d2a7a46b02cb3676ee44589cabe18d8","observation_id":"eb7f09a9-43ef-486c-83cb-8556fca7dad2","resolution":{"observed_at":"2026-08-11T15:17:38.677798Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2210.07574","last_updated":"2023-02-15T06:26:38Z","snapshot_observed_at":"2026-08-12T10:47:09.554460Z","submitted_at":"2022-10-14T06:54:24Z","title":"Is synthetic data from generative models ready for image recognition?","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2210.07574","snapshot_observed_at":"2026-08-11T15:17:38.681766Z","title":"Is synthetic data from generative models ready for image recognition?","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2412.11183","last_updated":"2025-08-22T08:05:31Z","snapshot_observed_at":"2026-08-11T15:10:22.471125Z","submitted_at":"2024-12-15T13:26:51Z","title":"OccScene: Semantic Occupancy-based Cross-task Mutual Learning for 3D Scene Generation","version":2},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-11T15:17:38.681766Z"},"links":{"cited_paper":"/paper/2210.07574","citing_paper":"/paper/2412.11183"},"observation_digest":"sha256:8e2a70c4750ac5f519230374ff69cb727edf4ef74ab467fa564ba6d2f30b8606","observation_id":"2da199c9-c244-41e3-a70c-97c72ab12a8b","resolution":{"observed_at":"2026-08-11T15:17:38.681766Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2304.13861","last_updated":"2024-02-05T14:41:35Z","snapshot_observed_at":"2026-07-06T15:20:33.204697Z","submitted_at":"2023-04-26T23:09:02Z","title":"The Parrot Dilemma: Human-Labeled vs. LLM-augmented Data in Classification Tasks","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2304.13861","snapshot_observed_at":"2026-08-11T15:17:38.685939Z","title":"Is a prompt and a few samples all you need? using gpt-4 for data augmentation in low-resource classification tasks,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2412.11183","last_updated":"2025-08-22T08:05:31Z","snapshot_observed_at":"2026-08-11T15:10:22.471125Z","submitted_at":"2024-12-15T13:26:51Z","title":"OccScene: Semantic Occupancy-based Cross-task Mutual Learning for 3D Scene Generation","version":2},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-11T15:17:38.685939Z"},"links":{"cited_paper":"/paper/2304.13861","citing_paper":"/paper/2412.11183"},"observation_digest":"sha256:8819b8a9607be2e96ea334261ba51c7287b77ce7f64b2af4987e4de46cb28bb5","observation_id":"506a99c3-9128-4cdb-9537-371bd81b2e20","resolution":{"observed_at":"2026-08-11T15:17:38.685939Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T15:17:39.915509Z","title":"Open- vocabulary object segmentation with diffusion models,","venue":null,"work_id":"1601c039-735d-4c23-9081-a46318d53226","year":2023},"citing_paper":{"arxiv_id":"2412.11183","last_updated":"2025-08-22T08:05:31Z","snapshot_observed_at":"2026-08-11T15:10:22.471125Z","submitted_at":"2024-12-15T13:26:51Z","title":"OccScene: Semantic Occupancy-based Cross-task Mutual Learning for 3D Scene Generation","version":2},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-11T15:17:38.689348Z"},"links":{"citing_paper":"/paper/2412.11183"},"observation_digest":"sha256:ac1eba395d43d69684604fcd198e890766ba68aaf1d62cef98494ca4235537a3","observation_id":"215269cc-4b6b-40ad-a469-11c3e3daf151","resolution":{"observed_at":"2026-08-11T15:17:39.919313Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T15:17:39.902271Z","title":"Datasetdm: Synthesizing data with perception annotations using diffusion models,","venue":null,"work_id":"7a466c74-ff56-4c47-8813-97d5d2cc3eb1","year":2023},"citing_paper":{"arxiv_id":"2412.11183","last_updated":"2025-08-22T08:05:31Z","snapshot_observed_at":"2026-08-11T15:10:22.471125Z","submitted_at":"2024-12-15T13:26:51Z","title":"OccScene: Semantic Occupancy-based Cross-task Mutual Learning for 3D Scene Generation","version":2},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-11T15:17:38.692928Z"},"links":{"citing_paper":"/paper/2412.11183"},"observation_digest":"sha256:d9f54c7efabb5c1a8e9f60004c0a1ec48074978a117601c4aae838f1e72d0cd4","observation_id":"47c0e50b-af33-4f10-af90-b9ec0dd520ab","resolution":{"observed_at":"2026-08-11T15:17:39.906831Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2403.06845","last_updated":"2024-04-11T04:17:13Z","snapshot_observed_at":"2026-08-13T00:57:30.544225Z","submitted_at":"2024-03-11T16:03:35Z","title":"DriveDreamer-2: LLM-Enhanced World Models for Diverse Driving Video Generation","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2403.06845","snapshot_observed_at":"2026-08-11T15:17:38.696378Z","title":"Drivedreamer-2: Llm-enhanced world models for diverse driving video generation,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2412.11183","last_updated":"2025-08-22T08:05:31Z","snapshot_observed_at":"2026-08-11T15:10:22.471125Z","submitted_at":"2024-12-15T13:26:51Z","title":"OccScene: Semantic Occupancy-based Cross-task Mutual Learning for 3D Scene Generation","version":2},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-11T15:17:38.696378Z"},"links":{"cited_paper":"/paper/2403.06845","citing_paper":"/paper/2412.11183"},"observation_digest":"sha256:a7b56e90e88caa169369ea5fb5db4fdc6821515f580d359a19985c3dfebfc62a","observation_id":"86dbedb4-5839-4270-929e-8b91890b3f7a","resolution":{"observed_at":"2026-08-11T15:17:38.696378Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T15:17:39.890248Z","title":"Magicdrive: Street view generation with diverse 3d geometry control,","venue":null,"work_id":"4ee6a49d-fe13-4de3-b4a6-89dee59c304e","year":2024},"citing_paper":{"arxiv_id":"2412.11183","last_updated":"2025-08-22T08:05:31Z","snapshot_observed_at":"2026-08-11T15:10:22.471125Z","submitted_at":"2024-12-15T13:26:51Z","title":"OccScene: Semantic Occupancy-based Cross-task Mutual Learning for 3D Scene Generation","version":2},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-11T15:17:38.699796Z"},"links":{"citing_paper":"/paper/2412.11183"},"observation_digest":"sha256:055dbc1c254e80d199c1d90dfae15f260dbf46799ff82863d05beec25581ccd3","observation_id":"5554e65c-9c0e-497a-8eaa-6cec888fe268","resolution":{"observed_at":"2026-08-11T15:17:39.893999Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T15:17:39.878809Z","title":"Driving into the future: Multiview visual forecasting and planning with world model for autonomous driving,","venue":null,"work_id":"61ae2ca6-724f-46ec-b2d9-be342ee64376","year":2024},"citing_paper":{"arxiv_id":"2412.11183","last_updated":"2025-08-22T08:05:31Z","snapshot_observed_at":"2026-08-11T15:10:22.471125Z","submitted_at":"2024-12-15T13:26:51Z","title":"OccScene: Semantic Occupancy-based Cross-task Mutual Learning for 3D Scene Generation","version":2},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-11T15:17:38.703116Z"},"links":{"citing_paper":"/paper/2412.11183"},"observation_digest":"sha256:c19e0136ffcb1d8e3cb3a57ace72f459bac40e4e09b2a859b0316df48baf0f41","observation_id":"a952f508-6151-4c11-8a44-f53de17c6be9","resolution":{"observed_at":"2026-08-11T15:17:39.882540Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T15:17:39.867652Z","title":"Monoscene: Monocular 3d semantic scene completion,","venue":null,"work_id":"d41a2afe-ae6f-4933-bc18-70c31d5bf69a","year":2022},"citing_paper":{"arxiv_id":"2412.11183","last_updated":"2025-08-22T08:05:31Z","snapshot_observed_at":"2026-08-11T15:10:22.471125Z","submitted_at":"2024-12-15T13:26:51Z","title":"OccScene: Semantic Occupancy-based Cross-task Mutual Learning for 3D Scene Generation","version":2},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-11T15:17:38.706434Z"},"links":{"citing_paper":"/paper/2412.11183"},"observation_digest":"sha256:5e1b1d3a9b4e1550b12bc3de322616f0ea3bb447477c80eda654bbdf0b4a1bf0","observation_id":"dba3fd3c-1306-4919-b4fe-c0d947f299b9","resolution":{"observed_at":"2026-08-11T15:17:39.871115Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T15:17:39.855980Z","title":"beta-vae: Learning basic visual concepts with a constrained variational framework,","venue":null,"work_id":"f5d7be3d-6060-48fe-a443-56d9fb7afa41","year":2016},"citing_paper":{"arxiv_id":"2412.11183","last_updated":"2025-08-22T08:05:31Z","snapshot_observed_at":"2026-08-11T15:10:22.471125Z","submitted_at":"2024-12-15T13:26:51Z","title":"OccScene: Semantic Occupancy-based Cross-task Mutual Learning for 3D Scene Generation","version":2},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-11T15:17:38.709904Z"},"links":{"citing_paper":"/paper/2412.11183"},"observation_digest":"sha256:84b840faf8a3df54a4e2bcffe9adeb6895d81e54ea9a4b43aee39c7110eebb18","observation_id":"66a64160-375b-4552-86b0-50210d0684c3","resolution":{"observed_at":"2026-08-11T15:17:39.859889Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T15:17:39.844355Z","title":"Dif- fusion autoencoders: Toward a meaningful and decodable representation,","venue":null,"work_id":"86d9abc9-d989-41e8-ac82-79202881b48f","year":2022},"citing_paper":{"arxiv_id":"2412.11183","last_updated":"2025-08-22T08:05:31Z","snapshot_observed_at":"2026-08-11T15:10:22.471125Z","submitted_at":"2024-12-15T13:26:51Z","title":"OccScene: Semantic Occupancy-based Cross-task Mutual Learning for 3D Scene Generation","version":2},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-08-11T15:17:38.713207Z"},"links":{"citing_paper":"/paper/2412.11183"},"observation_digest":"sha256:b7fb25fbed74225d3fba17c31565a08c0b6db602637cc499b1271445a6279517","observation_id":"a6b2868f-82f0-4448-9994-6f925d534e5b","resolution":{"observed_at":"2026-08-11T15:17:39.848393Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2402.02346","last_updated":"2025-09-09T14:21:23Z","snapshot_observed_at":"2026-07-06T17:24:57.402088Z","submitted_at":"2024-02-04T05:03:22Z","title":"Closed-Loop Unsupervised Representation Disentanglement with $\\beta$-VAE Distillation and Diffusion Probabilistic Feedback","version":2},"cited_work":{"arxiv_id":"2402.02346","doi":null,"metadata_source":"pith","pith_arxiv_id":"2402.02346","snapshot_observed_at":"2026-08-11T15:17:39.131383Z","title":"Closed-Loop Unsupervised Representation Disentanglement with $\\beta$-VAE Distillation and Diffusion Probabilistic Feedback","venue":"cs.CV","work_id":"c5e61470-f224-4b70-b7b5-6ef0aa751d65","year":2024},"citing_paper":{"arxiv_id":"2412.11183","last_updated":"2025-08-22T08:05:31Z","snapshot_observed_at":"2026-08-11T15:10:22.471125Z","submitted_at":"2024-12-15T13:26:51Z","title":"OccScene: Semantic Occupancy-based Cross-task Mutual Learning for 3D Scene Generation","version":2},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-08-11T15:17:38.716833Z"},"links":{"cited_paper":"/paper/2402.02346","citing_paper":"/paper/2412.11183"},"observation_digest":"sha256:a1612fd081b09f2471bc94dcd30dcef197d56601d665a99cddbd7d7913c86d72","observation_id":"90880d72-466f-436e-b5db-9023e353d8e8","resolution":{"observed_at":"2026-08-11T15:17:39.138965Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T15:17:38.720393Z","title":"Deep mutual learning,","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2412.11183","last_updated":"2025-08-22T08:05:31Z","snapshot_observed_at":"2026-08-11T15:10:22.471125Z","submitted_at":"2024-12-15T13:26:51Z","title":"OccScene: Semantic Occupancy-based Cross-task Mutual Learning for 3D Scene Generation","version":2},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-08-11T15:17:38.720393Z"},"links":{"citing_paper":"/paper/2412.11183"},"observation_digest":"sha256:3b80aa2440ad7dee8b34356b2995ced3c26c57bc1756e5a0725ce6c6ac133108","observation_id":"fd3b8d37-8d85-4bf9-86a9-1d1be95d2a91","resolution":{"observed_at":"2026-08-11T15:17:38.720393Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T15:17:39.823884Z","title":"Mutualnet: Adaptive convnet via mutual learning from different model configurations,","venue":null,"work_id":"7233f51d-3ab1-4c4c-a2c6-ea48af9aa211","year":2021},"citing_paper":{"arxiv_id":"2412.11183","last_updated":"2025-08-22T08:05:31Z","snapshot_observed_at":"2026-08-11T15:10:22.471125Z","submitted_at":"2024-12-15T13:26:51Z","title":"OccScene: Semantic Occupancy-based Cross-task Mutual Learning for 3D Scene Generation","version":2},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-08-11T15:17:38.723808Z"},"links":{"citing_paper":"/paper/2412.11183"},"observation_digest":"sha256:05b83bd253a8dc2d0ffc7130289514b5705191ca2b20910564157f922165093f","observation_id":"77a5c591-c922-44d9-b271-de0407df9227","resolution":{"observed_at":"2026-08-11T15:17:39.828084Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T15:17:39.810536Z","title":"Spatial-frequency mutual learning for face super-resolution,","venue":null,"work_id":"21d49241-0fbb-4ffd-80ee-5abfe0041a00","year":2023},"citing_paper":{"arxiv_id":"2412.11183","last_updated":"2025-08-22T08:05:31Z","snapshot_observed_at":"2026-08-11T15:10:22.471125Z","submitted_at":"2024-12-15T13:26:51Z","title":"OccScene: Semantic Occupancy-based Cross-task Mutual Learning for 3D Scene Generation","version":2},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-08-11T15:17:38.727207Z"},"links":{"citing_paper":"/paper/2412.11183"},"observation_digest":"sha256:b9912bb9fb561d56c3b587ffe0e9ac97901d3bda4f8f51d37874ab2edd58b2e6","observation_id":"6feae582-e388-4fe3-8216-21e37d931bd4","resolution":{"observed_at":"2026-08-11T15:17:39.814916Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T15:17:39.796824Z","title":"Deep unsupervised learning using nonequilibrium thermodynamics,","venue":null,"work_id":"9111f990-74b3-409e-96c7-6056774b6dab","year":2015},"citing_paper":{"arxiv_id":"2412.11183","last_updated":"2025-08-22T08:05:31Z","snapshot_observed_at":"2026-08-11T15:10:22.471125Z","submitted_at":"2024-12-15T13:26:51Z","title":"OccScene: Semantic Occupancy-based Cross-task Mutual Learning for 3D Scene Generation","version":2},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-08-11T15:17:38.730125Z"},"links":{"citing_paper":"/paper/2412.11183"},"observation_digest":"sha256:75132b54bcb7874ab856117abd2c638da455ab3abfe64102987fadbefeff99e1","observation_id":"4c04a817-dc65-4970-9fc8-048bff61efec","resolution":{"observed_at":"2026-08-11T15:17:39.801095Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T15:17:39.784400Z","title":"Diffustereo: High quality human reconstruction via diffusion-based stereo using sparse cameras,","venue":null,"work_id":"dcf2f40a-ea0b-42aa-9fe1-053cbced5d9d","year":2022},"citing_paper":{"arxiv_id":"2412.11183","last_updated":"2025-08-22T08:05:31Z","snapshot_observed_at":"2026-08-11T15:10:22.471125Z","submitted_at":"2024-12-15T13:26:51Z","title":"OccScene: Semantic Occupancy-based Cross-task Mutual Learning for 3D Scene Generation","version":2},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-08-11T15:17:38.733062Z"},"links":{"citing_paper":"/paper/2412.11183"},"observation_digest":"sha256:3f455f88ba8f41bc7be740cdd9e09b7810ba7cac61529b247f1d86ece3a4b866","observation_id":"d0d5610b-c52b-416e-9cfa-017851c5c5be","resolution":{"observed_at":"2026-08-11T15:17:39.788893Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T15:17:39.772378Z","title":"T2i-compbench: A comprehensive benchmark for open-world compositional text-to-image generation,","venue":null,"work_id":"6e917501-1133-4174-99df-18fed0a54f1b","year":2023},"citing_paper":{"arxiv_id":"2412.11183","last_updated":"2025-08-22T08:05:31Z","snapshot_observed_at":"2026-08-11T15:10:22.471125Z","submitted_at":"2024-12-15T13:26:51Z","title":"OccScene: Semantic Occupancy-based Cross-task Mutual Learning for 3D Scene Generation","version":2},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-08-11T15:17:38.736098Z"},"links":{"citing_paper":"/paper/2412.11183"},"observation_digest":"sha256:1e61f74aa587c1cc1c5e47451efb2692d2de1dd36bdd2a161ce4c868b78df069","observation_id":"ba585ef1-f558-4be4-825a-2e1a201d9249","resolution":{"observed_at":"2026-08-11T15:17:39.777107Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T15:17:38.739684Z","title":"Adding conditional control to text-to-image diffusion models,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2412.11183","last_updated":"2025-08-22T08:05:31Z","snapshot_observed_at":"2026-08-11T15:10:22.471125Z","submitted_at":"2024-12-15T13:26:51Z","title":"OccScene: Semantic Occupancy-based Cross-task Mutual Learning for 3D Scene Generation","version":2},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-08-11T15:17:38.739684Z"},"links":{"citing_paper":"/paper/2412.11183"},"observation_digest":"sha256:8552783160d703afdbb2d7ebd72dd41f21c51d0bfde9f7fa555d031b73a28b08","observation_id":"72a04be8-40b3-4a2d-9c13-f1e175f32bf3","resolution":{"observed_at":"2026-08-11T15:17:38.739684Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T15:17:38.743604Z","title":"Plug-and-play diffusion features for text-driven image-to-image translation,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2412.11183","last_updated":"2025-08-22T08:05:31Z","snapshot_observed_at":"2026-08-11T15:10:22.471125Z","submitted_at":"2024-12-15T13:26:51Z","title":"OccScene: Semantic Occupancy-based Cross-task Mutual Learning for 3D Scene Generation","version":2},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-08-11T15:17:38.743604Z"},"links":{"citing_paper":"/paper/2412.11183"},"observation_digest":"sha256:2401bf65b9ccd08c967322574a80cf01712da8dcbb408e6dcf2390a3276b5ca5","observation_id":"96e3ec6e-f776-4223-8583-36da43780d77","resolution":{"observed_at":"2026-08-11T15:17:38.743604Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T15:17:39.746498Z","title":"Tune-a-video: One-shot tuning of image diffusion models for text-to-video generation,","venue":null,"work_id":"24f8d83c-8c4c-4d65-ad49-9f2bdfeaa01a","year":2023},"citing_paper":{"arxiv_id":"2412.11183","last_updated":"2025-08-22T08:05:31Z","snapshot_observed_at":"2026-08-11T15:10:22.471125Z","submitted_at":"2024-12-15T13:26:51Z","title":"OccScene: Semantic Occupancy-based Cross-task Mutual Learning for 3D Scene Generation","version":2},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-08-11T15:17:38.747785Z"},"links":{"citing_paper":"/paper/2412.11183"},"observation_digest":"sha256:6d22115b35bab58734a062387ff2483755a770093f54b10432f5e88e5f7f1a18","observation_id":"88d0a2b5-5c5f-4add-8b81-82591f46ff25","resolution":{"observed_at":"2026-08-11T15:17:39.749982Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T15:17:38.751563Z","title":"Video generation models as world simulators,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2412.11183","last_updated":"2025-08-22T08:05:31Z","snapshot_observed_at":"2026-08-11T15:10:22.471125Z","submitted_at":"2024-12-15T13:26:51Z","title":"OccScene: Semantic Occupancy-based Cross-task Mutual Learning for 3D Scene Generation","version":2},"reference_index":36,"source":"pdf_text","source_observed_at":"2026-08-11T15:17:38.751563Z"},"links":{"citing_paper":"/paper/2412.11183"},"observation_digest":"sha256:591d43d78d54e79f04a74e7f6fa517e37321342f395c63698152a0446fc06f93","observation_id":"ea17a43f-7046-4464-aa90-df0368f6bea0","resolution":{"observed_at":"2026-08-11T15:17:38.751563Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T15:17:39.728743Z","title":"Learning universal policies via text-guided video generation,","venue":null,"work_id":"fb420806-f8b3-4a28-84be-4b285378ce82","year":2024},"citing_paper":{"arxiv_id":"2412.11183","last_updated":"2025-08-22T08:05:31Z","snapshot_observed_at":"2026-08-11T15:10:22.471125Z","submitted_at":"2024-12-15T13:26:51Z","title":"OccScene: Semantic Occupancy-based Cross-task Mutual Learning for 3D Scene Generation","version":2},"reference_index":37,"source":"pdf_text","source_observed_at":"2026-08-11T15:17:38.755227Z"},"links":{"citing_paper":"/paper/2412.11183"},"observation_digest":"sha256:6ed808554f0e0411fbefa972acd2be739309c2687b8fdcda6ad74c3120b148bc","observation_id":"257f169a-bbf6-48b3-aab3-db40e16709cd","resolution":{"observed_at":"2026-08-11T15:17:39.732274Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T15:17:39.717340Z","title":"Fetv: A benchmark for fine-grained evaluation of open-domain text-to-video generation,","venue":null,"work_id":"04f0efe4-7a9f-426b-9665-28444ed6cdec","year":2024},"citing_paper":{"arxiv_id":"2412.11183","last_updated":"2025-08-22T08:05:31Z","snapshot_observed_at":"2026-08-11T15:10:22.471125Z","submitted_at":"2024-12-15T13:26:51Z","title":"OccScene: Semantic Occupancy-based Cross-task Mutual Learning for 3D Scene Generation","version":2},"reference_index":38,"source":"pdf_text","source_observed_at":"2026-08-11T15:17:38.759358Z"},"links":{"citing_paper":"/paper/2412.11183"},"observation_digest":"sha256:dfaa7859d3e657baa5049879f04965fac87b3ba1a4b9c7b5fec0e83539128ebb","observation_id":"0aa696aa-5867-4953-a53d-df554821f5ae","resolution":{"observed_at":"2026-08-11T15:17:39.721149Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2403.19438","last_updated":"2024-12-26T10:33:31Z","snapshot_observed_at":"2026-08-13T00:43:00.286060Z","submitted_at":"2024-03-28T14:07:13Z","title":"SubjectDrive: Scaling Generative Data in Autonomous Driving via Subject Control","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2403.19438","snapshot_observed_at":"2026-08-11T15:17:38.763417Z","title":"Subjectdrive: Scaling generative data in autonomous driving via subject control,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2412.11183","last_updated":"2025-08-22T08:05:31Z","snapshot_observed_at":"2026-08-11T15:10:22.471125Z","submitted_at":"2024-12-15T13:26:51Z","title":"OccScene: Semantic Occupancy-based Cross-task Mutual Learning for 3D Scene Generation","version":2},"reference_index":39,"source":"pdf_text","source_observed_at":"2026-08-11T15:17:38.763417Z"},"links":{"cited_paper":"/paper/2403.19438","citing_paper":"/paper/2412.11183"},"observation_digest":"sha256:6bcea7362dda2cc6fefe85cd7049d4caf4ca8fcc9a787f2e3ddac6a7fb34d065","observation_id":"aa026b04-4c30-4876-96b8-9f92b096c80c","resolution":{"observed_at":"2026-08-11T15:17:38.763417Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T15:17:39.706406Z","title":"Mars: An instance-aware, modular and realistic simulator for autonomous driving,","venue":null,"work_id":"1b0102e2-eabb-4cdb-a88b-8780906b10d6","year":2023},"citing_paper":{"arxiv_id":"2412.11183","last_updated":"2025-08-22T08:05:31Z","snapshot_observed_at":"2026-08-11T15:10:22.471125Z","submitted_at":"2024-12-15T13:26:51Z","title":"OccScene: Semantic Occupancy-based Cross-task Mutual Learning for 3D Scene Generation","version":2},"reference_index":40,"source":"pdf_text","source_observed_at":"2026-08-11T15:17:38.767987Z"},"links":{"citing_paper":"/paper/2412.11183"},"observation_digest":"sha256:338db7d1be7af94313940d9732471914b45e2759b4e1129e836854d51140a425","observation_id":"2dedf5a5-1a7e-49a9-a2d4-e4f52b22e282","resolution":{"observed_at":"2026-08-11T15:17:39.709973Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2401.01339","last_updated":"2024-08-18T14:26:31Z","snapshot_observed_at":"2026-08-11T22:59:47.934207Z","submitted_at":"2024-01-02T18:59:55Z","title":"Street Gaussians: Modeling Dynamic Urban Scenes with Gaussian Splatting","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2401.01339","snapshot_observed_at":"2026-08-11T15:17:38.771931Z","title":"Street gaussians for modeling dynamic urban scenes,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2412.11183","last_updated":"2025-08-22T08:05:31Z","snapshot_observed_at":"2026-08-11T15:10:22.471125Z","submitted_at":"2024-12-15T13:26:51Z","title":"OccScene: Semantic Occupancy-based Cross-task Mutual Learning for 3D Scene Generation","version":2},"reference_index":41,"source":"pdf_text","source_observed_at":"2026-08-11T15:17:38.771931Z"},"links":{"cited_paper":"/paper/2401.01339","citing_paper":"/paper/2412.11183"},"observation_digest":"sha256:ef262bd66693244a9d5f52f3ab3e3658e2767563358ae7e30aebeae986cc0f36","observation_id":"c250a812-30b1-47db-a068-3ed60efee732","resolution":{"observed_at":"2026-08-11T15:17:38.771931Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T15:17:39.694587Z","title":"Diverse and aligned audio-to-video generation via text-to-video model adaptation,","venue":null,"work_id":"50ae22d3-86a2-4cde-b962-edc7396e2693","year":2024},"citing_paper":{"arxiv_id":"2412.11183","last_updated":"2025-08-22T08:05:31Z","snapshot_observed_at":"2026-08-11T15:10:22.471125Z","submitted_at":"2024-12-15T13:26:51Z","title":"OccScene: Semantic Occupancy-based Cross-task Mutual Learning for 3D Scene Generation","version":2},"reference_index":42,"source":"pdf_text","source_observed_at":"2026-08-11T15:17:38.775752Z"},"links":{"citing_paper":"/paper/2412.11183"},"observation_digest":"sha256:252b6474b7402d51591b6d6440f6f406fbd2c0c4f5ab6f046538f3e490e998de","observation_id":"9da922bc-fa86-4471-a936-e6da4f3d9d92","resolution":{"observed_at":"2026-08-11T15:17:39.698322Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T15:17:39.683613Z","title":"Bungeenerf: Progressive neural radiance field for extreme multi-scale scene rendering,","venue":null,"work_id":"484efeee-701b-4d39-8ce0-54a6816dc7cd","year":2022},"citing_paper":{"arxiv_id":"2412.11183","last_updated":"2025-08-22T08:05:31Z","snapshot_observed_at":"2026-08-11T15:10:22.471125Z","submitted_at":"2024-12-15T13:26:51Z","title":"OccScene: Semantic Occupancy-based Cross-task Mutual Learning for 3D Scene Generation","version":2},"reference_index":43,"source":"pdf_text","source_observed_at":"2026-08-11T15:17:38.779027Z"},"links":{"citing_paper":"/paper/2412.11183"},"observation_digest":"sha256:498c900c02437093a9634513608ec727f59bd8e3cba33b86c9f9cc0fce82ad00","observation_id":"414af088-1215-487b-bf13-0220d86d1538","resolution":{"observed_at":"2026-08-11T15:17:39.687445Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T15:17:39.672413Z","title":"Street-view image generation from a bird’s-eye view layout,","venue":null,"work_id":"37cab699-3a22-4c39-ae35-138fcd0c6830","year":2024},"citing_paper":{"arxiv_id":"2412.11183","last_updated":"2025-08-22T08:05:31Z","snapshot_observed_at":"2026-08-11T15:10:22.471125Z","submitted_at":"2024-12-15T13:26:51Z","title":"OccScene: Semantic Occupancy-based Cross-task Mutual Learning for 3D Scene Generation","version":2},"reference_index":44,"source":"pdf_text","source_observed_at":"2026-08-11T15:17:38.783433Z"},"links":{"citing_paper":"/paper/2412.11183"},"observation_digest":"sha256:512deb6a2dcd920af9fa9a5ea8185987cd667a1fff9bedc1b201569c82a16ee5","observation_id":"a9fcf7a6-9990-47e1-a093-216670d5a58f","resolution":{"observed_at":"2026-08-11T15:17:39.676227Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T15:17:39.661250Z","title":"Panacea: Panoramic and controllable video generation for autonomous driving,","venue":null,"work_id":"4d43ee04-2268-468e-aa78-132390f08d05","year":2023},"citing_paper":{"arxiv_id":"2412.11183","last_updated":"2025-08-22T08:05:31Z","snapshot_observed_at":"2026-08-11T15:10:22.471125Z","submitted_at":"2024-12-15T13:26:51Z","title":"OccScene: Semantic Occupancy-based Cross-task Mutual Learning for 3D Scene Generation","version":2},"reference_index":45,"source":"pdf_text","source_observed_at":"2026-08-11T15:17:38.786756Z"},"links":{"citing_paper":"/paper/2412.11183"},"observation_digest":"sha256:c30b8e71468cb11191311621a961cad12176a497c713f2d9efb4e7602e46b46f","observation_id":"98284cfd-0457-4232-bab9-9d307def2088","resolution":{"observed_at":"2026-08-11T15:17:39.665324Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T15:17:39.648953Z","title":"Scaling Diffusion Models to Real-World 3D LiDAR Scene Completion,","venue":null,"work_id":"942fe522-0408-4c96-9f92-df3ba5d28d23","year":2024},"citing_paper":{"arxiv_id":"2412.11183","last_updated":"2025-08-22T08:05:31Z","snapshot_observed_at":"2026-08-11T15:10:22.471125Z","submitted_at":"2024-12-15T13:26:51Z","title":"OccScene: Semantic Occupancy-based Cross-task Mutual Learning for 3D Scene Generation","version":2},"reference_index":46,"source":"pdf_text","source_observed_at":"2026-08-11T15:17:38.790140Z"},"links":{"citing_paper":"/paper/2412.11183"},"observation_digest":"sha256:91255239d3182c0bc08f8d7d765c11e4eb8a26b83b9b656b23423e80ce49f654","observation_id":"5a8172dd-6d9c-4005-bf53-b6ea4eed29a1","resolution":{"observed_at":"2026-08-11T15:17:39.653451Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T15:17:39.636601Z","title":"Semcity: Semantic scene generation with triplane diffusion,","venue":null,"work_id":"acf562b2-0c61-4829-89a9-7d35c138d517","year":2024},"citing_paper":{"arxiv_id":"2412.11183","last_updated":"2025-08-22T08:05:31Z","snapshot_observed_at":"2026-08-11T15:10:22.471125Z","submitted_at":"2024-12-15T13:26:51Z","title":"OccScene: Semantic Occupancy-based Cross-task Mutual Learning for 3D Scene Generation","version":2},"reference_index":47,"source":"pdf_text","source_observed_at":"2026-08-11T15:17:38.793617Z"},"links":{"citing_paper":"/paper/2412.11183"},"observation_digest":"sha256:a96fcfee3be53c5389e49f348b30c7eaf0819741e4d6306ff9fabd312717a807","observation_id":"28da310f-99f6-4901-836c-0d92264a48dc","resolution":{"observed_at":"2026-08-11T15:17:39.640762Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T15:17:39.625118Z","title":"3d semantic scene completion: A survey,","venue":null,"work_id":"17e3501e-18b1-4008-9518-4c8b2ee67ec5","year":2022},"citing_paper":{"arxiv_id":"2412.11183","last_updated":"2025-08-22T08:05:31Z","snapshot_observed_at":"2026-08-11T15:10:22.471125Z","submitted_at":"2024-12-15T13:26:51Z","title":"OccScene: Semantic Occupancy-based Cross-task Mutual Learning for 3D Scene Generation","version":2},"reference_index":48,"source":"pdf_text","source_observed_at":"2026-08-11T15:17:38.797121Z"},"links":{"citing_paper":"/paper/2412.11183"},"observation_digest":"sha256:5ac189ef33b32612b2b248023fc07b17ac7de433056bce2c1fe6d6b46cd772f1","observation_id":"74a2bf58-f7d8-4812-9ff6-e73fa75692e0","resolution":{"observed_at":"2026-08-11T15:17:39.628789Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T15:17:38.800889Z","title":"Semantic scene completion from a single depth image,","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2412.11183","last_updated":"2025-08-22T08:05:31Z","snapshot_observed_at":"2026-08-11T15:10:22.471125Z","submitted_at":"2024-12-15T13:26:51Z","title":"OccScene: Semantic Occupancy-based Cross-task Mutual Learning for 3D Scene Generation","version":2},"reference_index":49,"source":"pdf_text","source_observed_at":"2026-08-11T15:17:38.800889Z"},"links":{"citing_paper":"/paper/2412.11183"},"observation_digest":"sha256:a6cf76c68cc3fe578047e475bdc8edd03e913732a69d9f4cbd1d818055ea2625","observation_id":"e208dd70-9beb-4131-a7f8-2bb1c61745fc","resolution":{"observed_at":"2026-08-11T15:17:38.800889Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T15:17:39.606459Z","title":"Lmscnet: Lightweight multiscale 3d semantic completion,","venue":null,"work_id":"5dfa8e4e-30d0-4b8e-b167-5d41d1dbb8db","year":2020},"citing_paper":{"arxiv_id":"2412.11183","last_updated":"2025-08-22T08:05:31Z","snapshot_observed_at":"2026-08-11T15:10:22.471125Z","submitted_at":"2024-12-15T13:26:51Z","title":"OccScene: Semantic Occupancy-based Cross-task Mutual Learning for 3D Scene Generation","version":2},"reference_index":50,"source":"pdf_text","source_observed_at":"2026-08-11T15:17:38.804357Z"},"links":{"citing_paper":"/paper/2412.11183"},"observation_digest":"sha256:f0bb747842356f8b768ec5dcba7dac377c3b7cef022a6665d56ae6dc0d21ad15","observation_id":"46f9ae7c-7b77-4edd-aa38-19fc922fe48d","resolution":{"observed_at":"2026-08-11T15:17:39.610183Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T15:17:39.595084Z","title":"Sparse single sweep lidar point cloud segmentation via learning contextual shape priors from scene completion,","venue":null,"work_id":"e789c76e-fbb4-459e-9267-20ca9d0ba1db","year":2021},"citing_paper":{"arxiv_id":"2412.11183","last_updated":"2025-08-22T08:05:31Z","snapshot_observed_at":"2026-08-11T15:10:22.471125Z","submitted_at":"2024-12-15T13:26:51Z","title":"OccScene: Semantic Occupancy-based Cross-task Mutual Learning for 3D Scene Generation","version":2},"reference_index":51,"source":"pdf_text","source_observed_at":"2026-08-11T15:17:38.808205Z"},"links":{"citing_paper":"/paper/2412.11183"},"observation_digest":"sha256:89290aad88d7b0731e53b67901aa6bf078ad0041ec2e83bc35f08f243e378302","observation_id":"8b9d22e0-fdbc-4917-81fc-be1862d2e19d","resolution":{"observed_at":"2026-08-11T15:17:39.599072Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T15:17:39.584037Z","title":"Scpnet: Semantic scene completion on point cloud,","venue":null,"work_id":"8addc6b2-bf61-4a73-a9ab-d610594b8b54","year":2023},"citing_paper":{"arxiv_id":"2412.11183","last_updated":"2025-08-22T08:05:31Z","snapshot_observed_at":"2026-08-11T15:10:22.471125Z","submitted_at":"2024-12-15T13:26:51Z","title":"OccScene: Semantic Occupancy-based Cross-task Mutual Learning for 3D Scene Generation","version":2},"reference_index":52,"source":"pdf_text","source_observed_at":"2026-08-11T15:17:38.811840Z"},"links":{"citing_paper":"/paper/2412.11183"},"observation_digest":"sha256:c6fb6d9e4246ac76d694f08c876ec04551447a843e39f81f9a20589349c043fa","observation_id":"4663bc78-7743-41f7-8b53-05215c1695a6","resolution":{"observed_at":"2026-08-11T15:17:39.587993Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T15:17:39.572826Z","title":"Pasco: Urban 3d panoptic scene completion with uncertainty awareness,","venue":null,"work_id":"ff7dca66-39e0-4b19-8c35-315819dfbcd4","year":2024},"citing_paper":{"arxiv_id":"2412.11183","last_updated":"2025-08-22T08:05:31Z","snapshot_observed_at":"2026-08-11T15:10:22.471125Z","submitted_at":"2024-12-15T13:26:51Z","title":"OccScene: Semantic Occupancy-based Cross-task Mutual Learning for 3D Scene Generation","version":2},"reference_index":53,"source":"pdf_text","source_observed_at":"2026-08-11T15:17:38.815807Z"},"links":{"citing_paper":"/paper/2412.11183"},"observation_digest":"sha256:d431f2ede5d861ae08e02aa131343608d9acbce81fb555de0534d23590bcfdaf","observation_id":"59c57e58-97e4-480d-b16c-f6179b36cbe5","resolution":{"observed_at":"2026-08-11T15:17:39.576891Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T15:17:39.562016Z","title":"Scenerf: Self-supervised monocular 3d scene reconstruction with radiance fields,","venue":null,"work_id":"91030cab-adcf-4072-8fef-f817d95f6e73","year":2023},"citing_paper":{"arxiv_id":"2412.11183","last_updated":"2025-08-22T08:05:31Z","snapshot_observed_at":"2026-08-11T15:10:22.471125Z","submitted_at":"2024-12-15T13:26:51Z","title":"OccScene: Semantic Occupancy-based Cross-task Mutual Learning for 3D Scene Generation","version":2},"reference_index":54,"source":"pdf_text","source_observed_at":"2026-08-11T15:17:38.819260Z"},"links":{"citing_paper":"/paper/2412.11183"},"observation_digest":"sha256:b3ce23f8381e119d89426a4cd1bbb101aa78814bd08fcbe3c70fa4b9b775d71c","observation_id":"cdbfd1bc-d8f0-475a-be00-bcf598a8482e","resolution":{"observed_at":"2026-08-11T15:17:39.565689Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T15:17:39.549443Z","title":"Behind the scenes: Density fields for single view reconstruction,","venue":null,"work_id":"16ca0583-802e-4b46-8b65-2cdec5bdf825","year":2023},"citing_paper":{"arxiv_id":"2412.11183","last_updated":"2025-08-22T08:05:31Z","snapshot_observed_at":"2026-08-11T15:10:22.471125Z","submitted_at":"2024-12-15T13:26:51Z","title":"OccScene: Semantic Occupancy-based Cross-task Mutual Learning for 3D Scene Generation","version":2},"reference_index":55,"source":"pdf_text","source_observed_at":"2026-08-11T15:17:38.823245Z"},"links":{"citing_paper":"/paper/2412.11183"},"observation_digest":"sha256:a9fcc9cb3a6898e4c2beb6abde529c1cf1dd0a1f9519f8c0683abe4c14d7f467","observation_id":"efd83b71-e775-4080-97d4-5d346d39b05f","resolution":{"observed_at":"2026-08-11T15:17:39.553013Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T15:17:39.538740Z","title":"Selfocc: Self- supervised vision-based 3d occupancy prediction,","venue":null,"work_id":"46a53a53-0d95-44a0-a79e-a803a87ff521","year":2024},"citing_paper":{"arxiv_id":"2412.11183","last_updated":"2025-08-22T08:05:31Z","snapshot_observed_at":"2026-08-11T15:10:22.471125Z","submitted_at":"2024-12-15T13:26:51Z","title":"OccScene: Semantic Occupancy-based Cross-task Mutual Learning for 3D Scene Generation","version":2},"reference_index":56,"source":"pdf_text","source_observed_at":"2026-08-11T15:17:38.826727Z"},"links":{"citing_paper":"/paper/2412.11183"},"observation_digest":"sha256:6be79bb6086f85aa92bc4d9e71f5b1bcd52a3be0c0b6622e0e91d0b671dfc720","observation_id":"068c4a72-a5fc-4014-a2cd-1cdf856fc329","resolution":{"observed_at":"2026-08-11T15:17:39.542239Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T15:17:39.525921Z","title":"Indoor segmentation and support inference from rgbd images","venue":null,"work_id":"c2fed221-d407-4c11-9ef7-1e56ab411dd9","year":2012},"citing_paper":{"arxiv_id":"2412.11183","last_updated":"2025-08-22T08:05:31Z","snapshot_observed_at":"2026-08-11T15:10:22.471125Z","submitted_at":"2024-12-15T13:26:51Z","title":"OccScene: Semantic Occupancy-based Cross-task Mutual Learning for 3D Scene Generation","version":2},"reference_index":57,"source":"pdf_text","source_observed_at":"2026-08-11T15:17:38.830315Z"},"links":{"citing_paper":"/paper/2412.11183"},"observation_digest":"sha256:88d4a2cd943bcd3ad071ef94821a58af74fc81d1364722c2a693c157aa66ce5e","observation_id":"2939e033-a0d9-4a8c-bd64-3d27109fb9d3","resolution":{"observed_at":"2026-08-11T15:17:39.529895Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T15:17:39.513930Z","title":"S3cnet: A sparse semantic scene completion network for lidar point clouds,","venue":null,"work_id":"9062d527-a98b-4539-a7e1-520a0bb50e18","year":2021},"citing_paper":{"arxiv_id":"2412.11183","last_updated":"2025-08-22T08:05:31Z","snapshot_observed_at":"2026-08-11T15:10:22.471125Z","submitted_at":"2024-12-15T13:26:51Z","title":"OccScene: Semantic Occupancy-based Cross-task Mutual Learning for 3D Scene Generation","version":2},"reference_index":58,"source":"pdf_text","source_observed_at":"2026-08-11T15:17:38.833596Z"},"links":{"citing_paper":"/paper/2412.11183"},"observation_digest":"sha256:fe56fcb5b4f1b4a07acd3084df9c1e49dda6800cf13da8306ef21695fa21ee23","observation_id":"5ed920e6-ac19-4d63-ac77-39ec33d5c670","resolution":{"observed_at":"2026-08-11T15:17:39.517997Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T15:17:39.500842Z","title":"Scfusion: Real-time incremental scene reconstruction with semantic completion,","venue":null,"work_id":"d58c22a6-ea07-403e-bb9a-d669cfda3eac","year":2020},"citing_paper":{"arxiv_id":"2412.11183","last_updated":"2025-08-22T08:05:31Z","snapshot_observed_at":"2026-08-11T15:10:22.471125Z","submitted_at":"2024-12-15T13:26:51Z","title":"OccScene: Semantic Occupancy-based Cross-task Mutual Learning for 3D Scene Generation","version":2},"reference_index":59,"source":"pdf_text","source_observed_at":"2026-08-11T15:17:38.836937Z"},"links":{"citing_paper":"/paper/2412.11183"},"observation_digest":"sha256:f54cd081a3f1a90e3d2d25dead47e1d08a349a839293982f439e61e03408c231","observation_id":"5f9dc2a8-cd11-43ed-bf13-9d175f5fc68a","resolution":{"observed_at":"2026-08-11T15:17:39.505233Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T15:17:39.488350Z","title":"V oxformer: Sparse voxel transformer for camera-based 3d semantic scene completion,","venue":null,"work_id":"2a65beb6-edaf-45a9-807a-88886c845e4e","year":2023},"citing_paper":{"arxiv_id":"2412.11183","last_updated":"2025-08-22T08:05:31Z","snapshot_observed_at":"2026-08-11T15:10:22.471125Z","submitted_at":"2024-12-15T13:26:51Z","title":"OccScene: Semantic Occupancy-based Cross-task Mutual Learning for 3D Scene Generation","version":2},"reference_index":60,"source":"pdf_text","source_observed_at":"2026-08-11T15:17:38.840111Z"},"links":{"citing_paper":"/paper/2412.11183"},"observation_digest":"sha256:eb923deb89e004d9b70340bb1746dfd4061c1b223d8948c66bab124bc2ac7df4","observation_id":"1c43f25d-9323-4596-924d-e8b6354afd85","resolution":{"observed_at":"2026-08-11T15:17:39.492545Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T15:17:39.477623Z","title":"Hierarchical temporal context learning for camera-based semantic scene completion,","venue":null,"work_id":"995b1201-f91a-406e-8a98-1a87fa5e9fb8","year":2024},"citing_paper":{"arxiv_id":"2412.11183","last_updated":"2025-08-22T08:05:31Z","snapshot_observed_at":"2026-08-11T15:10:22.471125Z","submitted_at":"2024-12-15T13:26:51Z","title":"OccScene: Semantic Occupancy-based Cross-task Mutual Learning for 3D Scene Generation","version":2},"reference_index":61,"source":"pdf_text","source_observed_at":"2026-08-11T15:17:38.843256Z"},"links":{"citing_paper":"/paper/2412.11183"},"observation_digest":"sha256:a099490736441d05aaa2b0ab8e0ea37fd9739d6dacb3fece6895848789d2d5cc","observation_id":"3fcf4c04-481e-4b4f-8ad2-00601c8eb048","resolution":{"observed_at":"2026-08-11T15:17:39.481147Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T15:17:39.467264Z","title":"Tri-perspective view for vision-based 3d semantic occupancy prediction,","venue":null,"work_id":"a9b97aac-98cb-4c14-ab36-d7ad2c3b9a16","year":2023},"citing_paper":{"arxiv_id":"2412.11183","last_updated":"2025-08-22T08:05:31Z","snapshot_observed_at":"2026-08-11T15:10:22.471125Z","submitted_at":"2024-12-15T13:26:51Z","title":"OccScene: Semantic Occupancy-based Cross-task Mutual Learning for 3D Scene Generation","version":2},"reference_index":62,"source":"pdf_text","source_observed_at":"2026-08-11T15:17:38.846856Z"},"links":{"citing_paper":"/paper/2412.11183"},"observation_digest":"sha256:ae662acdaa1abac38565da2f3a3090a20b0730f7ba7f4a50550a4b60eda1b22a","observation_id":"ebd57e0a-b6af-4984-b84e-267a75d7340b","resolution":{"observed_at":"2026-08-11T15:17:39.470763Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T15:17:39.456267Z","title":"Occformer: Dual-path transformer for vision-based 3d semantic occupancy prediction,","venue":null,"work_id":"feb359c2-a722-4e3b-b440-ad0437eaede7","year":2023},"citing_paper":{"arxiv_id":"2412.11183","last_updated":"2025-08-22T08:05:31Z","snapshot_observed_at":"2026-08-11T15:10:22.471125Z","submitted_at":"2024-12-15T13:26:51Z","title":"OccScene: Semantic Occupancy-based Cross-task Mutual Learning for 3D Scene Generation","version":2},"reference_index":63,"source":"pdf_text","source_observed_at":"2026-08-11T15:17:38.850333Z"},"links":{"citing_paper":"/paper/2412.11183"},"observation_digest":"sha256:da38cb3f05aaf6a85b276d4e5b33c86c783b4cbe724cf214cb31b4b7f5dc6d37","observation_id":"1aa5774c-7f8d-4866-8aff-10afbd0e7c21","resolution":{"observed_at":"2026-08-11T15:17:39.459864Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T15:17:39.445331Z","title":"Surroundocc: Multi-camera 3d occupancy prediction for autonomous driving,","venue":null,"work_id":"c258b4ac-bd1a-49a2-805d-a084abc68c4e","year":2023},"citing_paper":{"arxiv_id":"2412.11183","last_updated":"2025-08-22T08:05:31Z","snapshot_observed_at":"2026-08-11T15:10:22.471125Z","submitted_at":"2024-12-15T13:26:51Z","title":"OccScene: Semantic Occupancy-based Cross-task Mutual Learning for 3D Scene Generation","version":2},"reference_index":64,"source":"pdf_text","source_observed_at":"2026-08-11T15:17:38.853919Z"},"links":{"citing_paper":"/paper/2412.11183"},"observation_digest":"sha256:586043d6c5945fa1a1f50f770f2bb7acb6881ca8027ea38467d7c6eda709ccc8","observation_id":"3fd0244e-f6d6-4d23-af96-004c61dbaab3","resolution":{"observed_at":"2026-08-11T15:17:39.449198Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T15:17:38.857159Z","title":"Image super-resolution via iterative refinement,","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2412.11183","last_updated":"2025-08-22T08:05:31Z","snapshot_observed_at":"2026-08-11T15:10:22.471125Z","submitted_at":"2024-12-15T13:26:51Z","title":"OccScene: Semantic Occupancy-based Cross-task Mutual Learning for 3D Scene Generation","version":2},"reference_index":65,"source":"pdf_text","source_observed_at":"2026-08-11T15:17:38.857159Z"},"links":{"citing_paper":"/paper/2412.11183"},"observation_digest":"sha256:28922eedf0c5c7cb60c9f8e9e035d667a37b5bd786e8938b89ca1ec09acd7341","observation_id":"af7597f6-2b15-4422-a6c0-80deb6348e3d","resolution":{"observed_at":"2026-08-11T15:17:38.857159Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T15:17:38.860270Z","title":"Denoising diffusion probabilistic models,","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2412.11183","last_updated":"2025-08-22T08:05:31Z","snapshot_observed_at":"2026-08-11T15:10:22.471125Z","submitted_at":"2024-12-15T13:26:51Z","title":"OccScene: Semantic Occupancy-based Cross-task Mutual Learning for 3D Scene Generation","version":2},"reference_index":66,"source":"pdf_text","source_observed_at":"2026-08-11T15:17:38.860270Z"},"links":{"citing_paper":"/paper/2412.11183"},"observation_digest":"sha256:18c42fd46cb76fc82f4572e0f96a6695d1d0f2b1fd1e96a307e0393a3e7af89f","observation_id":"6ae6a2bc-6b28-44e3-8c54-f93a7b815758","resolution":{"observed_at":"2026-08-11T15:17:38.860270Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2208.01626","last_updated":"2022-08-02T17:55:41Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2022-08-02T17:55:41Z","title":"Prompt-to-Prompt Image Editing with Cross Attention Control","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2208.01626","snapshot_observed_at":"2026-08-11T15:17:38.864281Z","title":"Prompt-to-prompt image editing with cross attention control,","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2412.11183","last_updated":"2025-08-22T08:05:31Z","snapshot_observed_at":"2026-08-11T15:10:22.471125Z","submitted_at":"2024-12-15T13:26:51Z","title":"OccScene: Semantic Occupancy-based Cross-task Mutual Learning for 3D Scene Generation","version":2},"reference_index":67,"source":"pdf_text","source_observed_at":"2026-08-11T15:17:38.864281Z"},"links":{"cited_paper":"/paper/2208.01626","citing_paper":"/paper/2412.11183"},"observation_digest":"sha256:9fe4108b700adfec224bc61f5b929a8ce08782fde35e8963a8c780b312859912","observation_id":"747f90ef-85a8-40fe-8dfc-7644ebdc3375","resolution":{"observed_at":"2026-08-11T15:17:38.864281Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2312.00752","last_updated":"2024-05-31T17:55:27Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2023-12-01T18:01:34Z","title":"Mamba: Linear-Time Sequence Modeling with Selective State Spaces","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2312.00752","snapshot_observed_at":"2026-08-11T15:17:38.868750Z","title":"Mamba: Linear-time sequence modeling with selective state spaces,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2412.11183","last_updated":"2025-08-22T08:05:31Z","snapshot_observed_at":"2026-08-11T15:10:22.471125Z","submitted_at":"2024-12-15T13:26:51Z","title":"OccScene: Semantic Occupancy-based Cross-task Mutual Learning for 3D Scene Generation","version":2},"reference_index":68,"source":"pdf_text","source_observed_at":"2026-08-11T15:17:38.868750Z"},"links":{"cited_paper":"/paper/2312.00752","citing_paper":"/paper/2412.11183"},"observation_digest":"sha256:692cab98b0f0b45498fa195695d21b714d606499db8cfe1bea8cc612d1efd8c7","observation_id":"c4a55bc2-72b6-4333-a9bd-2afcf999b9d6","resolution":{"observed_at":"2026-08-11T15:17:38.868750Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2405.21060","last_updated":"2024-05-31T17:50:01Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-05-31T17:50:01Z","title":"Transformers are SSMs: Generalized Models and Efficient Algorithms Through Structured State Space Duality","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2405.21060","snapshot_observed_at":"2026-08-11T15:17:38.873134Z","title":"Transformers are ssms: Generalized models and efficient algorithms through structured state space duality,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2412.11183","last_updated":"2025-08-22T08:05:31Z","snapshot_observed_at":"2026-08-11T15:10:22.471125Z","submitted_at":"2024-12-15T13:26:51Z","title":"OccScene: Semantic Occupancy-based Cross-task Mutual Learning for 3D Scene Generation","version":2},"reference_index":69,"source":"pdf_text","source_observed_at":"2026-08-11T15:17:38.873134Z"},"links":{"cited_paper":"/paper/2405.21060","citing_paper":"/paper/2412.11183"},"observation_digest":"sha256:91895aa53a69adcb020ed7df16d5139fea98ff879925cdf40e8977200953e8c4","observation_id":"3ea7b3bf-d6bb-4fdb-87e0-2be3757c54af","resolution":{"observed_at":"2026-08-11T15:17:38.873134Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2401.10166","last_updated":"2024-12-29T14:57:13Z","snapshot_observed_at":"2026-07-06T17:17:31.008185Z","submitted_at":"2024-01-18T17:55:39Z","title":"VMamba: Visual State Space Model","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2401.10166","snapshot_observed_at":"2026-08-11T15:17:38.877076Z","title":"Vmamba: Visual state space model,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2412.11183","last_updated":"2025-08-22T08:05:31Z","snapshot_observed_at":"2026-08-11T15:10:22.471125Z","submitted_at":"2024-12-15T13:26:51Z","title":"OccScene: Semantic Occupancy-based Cross-task Mutual Learning for 3D Scene Generation","version":2},"reference_index":70,"source":"pdf_text","source_observed_at":"2026-08-11T15:17:38.877076Z"},"links":{"cited_paper":"/paper/2401.10166","citing_paper":"/paper/2412.11183"},"observation_digest":"sha256:38789d3307a433ca60b7d6d37418378f5883f5f857ce87c0bf8025cd5352636d","observation_id":"edd8b7b5-46c2-4e0b-a0d0-77d2595219b4","resolution":{"observed_at":"2026-08-11T15:17:38.877076Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2402.10739","last_updated":"2024-11-25T01:45:35Z","snapshot_observed_at":"2026-08-10T12:05:50.451265Z","submitted_at":"2024-02-16T14:56:13Z","title":"PointMamba: A Simple State Space Model for Point Cloud Analysis","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.10739","snapshot_observed_at":"2026-08-11T15:17:38.881359Z","title":"Pointmamba: A simple state space model for point cloud analysis,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2412.11183","last_updated":"2025-08-22T08:05:31Z","snapshot_observed_at":"2026-08-11T15:10:22.471125Z","submitted_at":"2024-12-15T13:26:51Z","title":"OccScene: Semantic Occupancy-based Cross-task Mutual Learning for 3D Scene Generation","version":2},"reference_index":71,"source":"pdf_text","source_observed_at":"2026-08-11T15:17:38.881359Z"},"links":{"cited_paper":"/paper/2402.10739","citing_paper":"/paper/2412.11183"},"observation_digest":"sha256:93b862f7fb77d042a71b8b770bb652fc12d9688ab017a3b2a63711a8a22bef59","observation_id":"4933e147-64c6-48c5-aa10-5623374b6a15","resolution":{"observed_at":"2026-08-11T15:17:38.881359Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T15:17:39.420302Z","title":"On large-batch training for deep learning: Generalization gap and sharp minima,","venue":null,"work_id":"b3cf82dc-68d3-4f25-b851-b2e1a770a6fe","year":2017},"citing_paper":{"arxiv_id":"2412.11183","last_updated":"2025-08-22T08:05:31Z","snapshot_observed_at":"2026-08-11T15:10:22.471125Z","submitted_at":"2024-12-15T13:26:51Z","title":"OccScene: Semantic Occupancy-based Cross-task Mutual Learning for 3D Scene Generation","version":2},"reference_index":72,"source":"pdf_text","source_observed_at":"2026-08-11T15:17:38.886004Z"},"links":{"citing_paper":"/paper/2412.11183"},"observation_digest":"sha256:4b5ddf9df69723de63e59857351868fb270e22176f11cf7d2ada2e04f3305d62","observation_id":"92269d5c-0144-46fa-af0c-92668e5037fe","resolution":{"observed_at":"2026-08-11T15:17:39.424241Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T15:17:39.407592Z","title":"Entropy-sgd: Biasing gradient descent into wide valleys,","venue":null,"work_id":"0ca33131-fa2a-430f-973e-0b6cf3b89f30","year":2019},"citing_paper":{"arxiv_id":"2412.11183","last_updated":"2025-08-22T08:05:31Z","snapshot_observed_at":"2026-08-11T15:10:22.471125Z","submitted_at":"2024-12-15T13:26:51Z","title":"OccScene: Semantic Occupancy-based Cross-task Mutual Learning for 3D Scene Generation","version":2},"reference_index":73,"source":"pdf_text","source_observed_at":"2026-08-11T15:17:38.889300Z"},"links":{"citing_paper":"/paper/2412.11183"},"observation_digest":"sha256:92e9b16ee82b09d8cef5f2d70b72679a5d0692e9bd1ed24138d8f59ca6939fe3","observation_id":"68020358-6bfc-48c4-a366-e6fefbc5b5a7","resolution":{"observed_at":"2026-08-11T15:17:39.411985Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T15:17:39.396122Z","title":"Understanding deep learning requires rethinking generalization,","venue":null,"work_id":"a8780d29-87af-4dde-87ea-cb5075711f98","year":2021},"citing_paper":{"arxiv_id":"2412.11183","last_updated":"2025-08-22T08:05:31Z","snapshot_observed_at":"2026-08-11T15:10:22.471125Z","submitted_at":"2024-12-15T13:26:51Z","title":"OccScene: Semantic Occupancy-based Cross-task Mutual Learning for 3D Scene Generation","version":2},"reference_index":74,"source":"pdf_text","source_observed_at":"2026-08-11T15:17:38.892494Z"},"links":{"citing_paper":"/paper/2412.11183"},"observation_digest":"sha256:cf29e12bc778f7bf8fcbf697698b85fd3c536b6f5bb912e99e1fa4b2cc356eeb","observation_id":"af9dc410-49e4-4757-a7ce-6a3d49a21c8a","resolution":{"observed_at":"2026-08-11T15:17:39.399920Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T15:17:39.382391Z","title":"Semantickitti: A dataset for semantic scene understanding of lidar sequences,","venue":null,"work_id":"7d97e779-0bb5-41de-b02f-9ecf23eb92ec","year":2019},"citing_paper":{"arxiv_id":"2412.11183","last_updated":"2025-08-22T08:05:31Z","snapshot_observed_at":"2026-08-11T15:10:22.471125Z","submitted_at":"2024-12-15T13:26:51Z","title":"OccScene: Semantic Occupancy-based Cross-task Mutual Learning for 3D Scene Generation","version":2},"reference_index":75,"source":"pdf_text","source_observed_at":"2026-08-11T15:17:38.896025Z"},"links":{"citing_paper":"/paper/2412.11183"},"observation_digest":"sha256:409c64fbfdc62d4b160847e8965ac835dc9cde1f603d053ea12aacd38080842b","observation_id":"0f4aa893-2488-424f-a026-acf4f0b1bd6e","resolution":{"observed_at":"2026-08-11T15:17:39.386849Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T15:17:38.899494Z","title":"nuscenes: A multimodal dataset for autonomous driving,","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2412.11183","last_updated":"2025-08-22T08:05:31Z","snapshot_observed_at":"2026-08-11T15:10:22.471125Z","submitted_at":"2024-12-15T13:26:51Z","title":"OccScene: Semantic Occupancy-based Cross-task Mutual Learning for 3D Scene Generation","version":2},"reference_index":76,"source":"pdf_text","source_observed_at":"2026-08-11T15:17:38.899494Z"},"links":{"citing_paper":"/paper/2412.11183"},"observation_digest":"sha256:ef0664dd33818945e37b948e3e7d994e0b1c388964bb52903034b483739dc23b","observation_id":"2a3bc838-3c8d-47ba-bec3-4a2eb7c14053","resolution":{"observed_at":"2026-08-11T15:17:38.899494Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T15:17:39.360879Z","title":"Openoccupancy: A large scale benchmark for surrounding semantic occupancy perception,","venue":null,"work_id":"fe10c789-670a-4bdb-b01c-fa96b699b0fb","year":2023},"citing_paper":{"arxiv_id":"2412.11183","last_updated":"2025-08-22T08:05:31Z","snapshot_observed_at":"2026-08-11T15:10:22.471125Z","submitted_at":"2024-12-15T13:26:51Z","title":"OccScene: Semantic Occupancy-based Cross-task Mutual Learning for 3D Scene Generation","version":2},"reference_index":77,"source":"pdf_text","source_observed_at":"2026-08-11T15:17:38.902746Z"},"links":{"citing_paper":"/paper/2412.11183"},"observation_digest":"sha256:7c51a7d303236d20949f4881835bf3e85099fd1203682971d76d5e1139815bd4","observation_id":"a02949bc-ac76-477a-afd6-9523cfd6766c","resolution":{"observed_at":"2026-08-11T15:17:39.365419Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T15:17:38.906205Z","title":"Gans trained by a two time-scale update rule converge to a local nash equilibrium,","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2412.11183","last_updated":"2025-08-22T08:05:31Z","snapshot_observed_at":"2026-08-11T15:10:22.471125Z","submitted_at":"2024-12-15T13:26:51Z","title":"OccScene: Semantic Occupancy-based Cross-task Mutual Learning for 3D Scene Generation","version":2},"reference_index":78,"source":"pdf_text","source_observed_at":"2026-08-11T15:17:38.906205Z"},"links":{"citing_paper":"/paper/2412.11183"},"observation_digest":"sha256:a9d4e282e65b9325bf77c1e9a7321a0404b07a1e64f829f1af4310a34780761e","observation_id":"702ece8e-a496-4fb2-8096-d9eab55af711","resolution":{"observed_at":"2026-08-11T15:17:38.906205Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1812.01717","last_updated":"2019-03-27T16:43:17Z","snapshot_observed_at":"2026-08-11T02:30:38.877941Z","submitted_at":"2018-12-03T03:57:42Z","title":"Towards Accurate Generative Models of Video: A New Metric & Challenges","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1812.01717","snapshot_observed_at":"2026-08-11T15:17:38.909781Z","title":"Towards accurate generative models of video: A new metric & challenges,","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2412.11183","last_updated":"2025-08-22T08:05:31Z","snapshot_observed_at":"2026-08-11T15:10:22.471125Z","submitted_at":"2024-12-15T13:26:51Z","title":"OccScene: Semantic Occupancy-based Cross-task Mutual Learning for 3D Scene Generation","version":2},"reference_index":79,"source":"pdf_text","source_observed_at":"2026-08-11T15:17:38.909781Z"},"links":{"cited_paper":"/paper/1812.01717","citing_paper":"/paper/2412.11183"},"observation_digest":"sha256:2580a8646723a29283af1f6a2416254e06567cc435f1af2db408c8d2c316cf6e","observation_id":"a671182f-25e0-4639-bd40-3e4c14c4e29b","resolution":{"observed_at":"2026-08-11T15:17:38.909781Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T15:17:39.338649Z","title":"Drivegan: Towards a controllable high-quality neural simulation,","venue":null,"work_id":"09a9ba0e-e808-4b45-8fee-fdfcad6c643f","year":2021},"citing_paper":{"arxiv_id":"2412.11183","last_updated":"2025-08-22T08:05:31Z","snapshot_observed_at":"2026-08-11T15:10:22.471125Z","submitted_at":"2024-12-15T13:26:51Z","title":"OccScene: Semantic Occupancy-based Cross-task Mutual Learning for 3D Scene Generation","version":2},"reference_index":80,"source":"pdf_text","source_observed_at":"2026-08-11T15:17:38.913600Z"},"links":{"citing_paper":"/paper/2412.11183"},"observation_digest":"sha256:cf84cc7551b66a98a1045acc96c6334e1f439a03a4df4449d28d0ff5e3248286","observation_id":"d3573c98-158c-4b94-a187-4062c100de74","resolution":{"observed_at":"2026-08-11T15:17:39.342955Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T15:17:39.325852Z","title":"Anisotropic convolutional networks for 3d semantic scene completion,","venue":null,"work_id":"ab16fa07-097c-4f25-bda3-05c43b573127","year":2020},"citing_paper":{"arxiv_id":"2412.11183","last_updated":"2025-08-22T08:05:31Z","snapshot_observed_at":"2026-08-11T15:10:22.471125Z","submitted_at":"2024-12-15T13:26:51Z","title":"OccScene: Semantic Occupancy-based Cross-task Mutual Learning for 3D Scene Generation","version":2},"reference_index":81,"source":"pdf_text","source_observed_at":"2026-08-11T15:17:38.916890Z"},"links":{"citing_paper":"/paper/2412.11183"},"observation_digest":"sha256:1e16c2d02957776fe280fb557de4033f66d0a147ce8cf5ce4eba2dca008e76af","observation_id":"cf5fdd99-1683-4f5a-a7c1-ba875cd26f84","resolution":{"observed_at":"2026-08-11T15:17:39.330242Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T15:17:39.312381Z","title":"3d sketch-aware semantic scene completion via semi-supervised structure prior,","venue":null,"work_id":"3f144acb-8665-432e-9d0b-18c037a6b84a","year":2020},"citing_paper":{"arxiv_id":"2412.11183","last_updated":"2025-08-22T08:05:31Z","snapshot_observed_at":"2026-08-11T15:10:22.471125Z","submitted_at":"2024-12-15T13:26:51Z","title":"OccScene: Semantic Occupancy-based Cross-task Mutual Learning for 3D Scene Generation","version":2},"reference_index":82,"source":"pdf_text","source_observed_at":"2026-08-11T15:17:38.919945Z"},"links":{"citing_paper":"/paper/2412.11183"},"observation_digest":"sha256:8a3adaffb1a88342d299a426e5646f1f5ff7bdd7a4ebce0a24ab0a2cf47a232e","observation_id":"71a89345-130d-4e56-8fcd-099dbc19d5c2","resolution":{"observed_at":"2026-08-11T15:17:39.317277Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T15:17:39.299924Z","title":"Ndc- scene: Boost monocular 3d semantic scene completion in normalized device coordinates space,","venue":null,"work_id":"365d3ed6-2121-4895-8af5-7cb166f60251","year":2023},"citing_paper":{"arxiv_id":"2412.11183","last_updated":"2025-08-22T08:05:31Z","snapshot_observed_at":"2026-08-11T15:10:22.471125Z","submitted_at":"2024-12-15T13:26:51Z","title":"OccScene: Semantic Occupancy-based Cross-task Mutual Learning for 3D Scene Generation","version":2},"reference_index":83,"source":"pdf_text","source_observed_at":"2026-08-11T15:17:38.923683Z"},"links":{"citing_paper":"/paper/2412.11183"},"observation_digest":"sha256:8c18becdd21ff7669ffd567df490c027edb8c4706809ae5516467ba6560f2c02","observation_id":"7c3a4899-2639-4f64-807b-283cce2a98ae","resolution":{"observed_at":"2026-08-11T15:17:39.304006Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T15:17:39.287153Z","title":"Monocular occupancy prediction for scalable indoor scenes,","venue":null,"work_id":"dfb87926-8c7a-45d8-b4ea-a2e5ef7a8b1a","year":2024},"citing_paper":{"arxiv_id":"2412.11183","last_updated":"2025-08-22T08:05:31Z","snapshot_observed_at":"2026-08-11T15:10:22.471125Z","submitted_at":"2024-12-15T13:26:51Z","title":"OccScene: Semantic Occupancy-based Cross-task Mutual Learning for 3D Scene Generation","version":2},"reference_index":84,"source":"pdf_text","source_observed_at":"2026-08-11T15:17:38.926849Z"},"links":{"citing_paper":"/paper/2412.11183"},"observation_digest":"sha256:ac19f4a77836b3948658708b1be332a6ad909816a4eea3325c28b5b80f4581fc","observation_id":"09556103-4435-4242-a3e6-074c78b409c3","resolution":{"observed_at":"2026-08-11T15:17:39.291699Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2405.13675","last_updated":"2024-10-22T14:28:56Z","snapshot_observed_at":"2026-08-13T00:02:08.851577Z","submitted_at":"2024-05-22T14:16:30Z","title":"Context and Geometry Aware Voxel Transformer for Semantic Scene Completion","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2405.13675","snapshot_observed_at":"2026-08-11T15:17:38.930081Z","title":"Context and geometry aware voxel transformer for semantic scene completion,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2412.11183","last_updated":"2025-08-22T08:05:31Z","snapshot_observed_at":"2026-08-11T15:10:22.471125Z","submitted_at":"2024-12-15T13:26:51Z","title":"OccScene: Semantic Occupancy-based Cross-task Mutual Learning for 3D Scene Generation","version":2},"reference_index":85,"source":"pdf_text","source_observed_at":"2026-08-11T15:17:38.930081Z"},"links":{"cited_paper":"/paper/2405.13675","citing_paper":"/paper/2412.11183"},"observation_digest":"sha256:9237f016b87ee791bb762efe2539955da6b6a41724f80649452ed6a17e6940ff","observation_id":"384841ea-e68c-41a0-ba2c-0b94423eeaab","resolution":{"observed_at":"2026-08-11T15:17:38.930081Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2301.00527","last_updated":"2023-01-02T05:00:11Z","snapshot_observed_at":"2026-08-05T11:53:08.503918Z","submitted_at":"2023-01-02T05:00:11Z","title":"Diffusion Probabilistic Models for Scene-Scale 3D Categorical Data","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2301.00527","snapshot_observed_at":"2026-08-11T15:17:38.933482Z","title":"Diffusion probabilistic models for scene-scale 3d categorical data,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2412.11183","last_updated":"2025-08-22T08:05:31Z","snapshot_observed_at":"2026-08-11T15:10:22.471125Z","submitted_at":"2024-12-15T13:26:51Z","title":"OccScene: Semantic Occupancy-based Cross-task Mutual Learning for 3D Scene Generation","version":2},"reference_index":86,"source":"pdf_text","source_observed_at":"2026-08-11T15:17:38.933482Z"},"links":{"cited_paper":"/paper/2301.00527","citing_paper":"/paper/2412.11183"},"observation_digest":"sha256:96e04630818c52a1f038c6344a099a15df9f316abb5818e0b8fe0897417a7a17","observation_id":"ff28915d-7ffc-4f6d-a422-421a548da20f","resolution":{"observed_at":"2026-08-11T15:17:38.933482Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1801.01401","last_updated":"2021-01-14T05:36:59Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2018-01-04T15:25:26Z","title":"Demystifying MMD GANs","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1801.01401","snapshot_observed_at":"2026-08-11T15:17:38.937354Z","title":"Demystifying mmd gans,","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2412.11183","last_updated":"2025-08-22T08:05:31Z","snapshot_observed_at":"2026-08-11T15:10:22.471125Z","submitted_at":"2024-12-15T13:26:51Z","title":"OccScene: Semantic Occupancy-based Cross-task Mutual Learning for 3D Scene Generation","version":2},"reference_index":87,"source":"pdf_text","source_observed_at":"2026-08-11T15:17:38.937354Z"},"links":{"cited_paper":"/paper/1801.01401","citing_paper":"/paper/2412.11183"},"observation_digest":"sha256:9a64913a5010cf40a5157a169ff03964cc87636a9638cd5ae89702e1c33371ff","observation_id":"94c0904c-fa45-4ee7-b530-e5072296a571","resolution":{"observed_at":"2026-08-11T15:17:38.937354Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T15:17:39.274813Z","title":"Diffusion convolutional recurrent neural network: Data-driven traffic forecasting,","venue":null,"work_id":"2c05c488-79b5-4949-b3e0-e677d993d19b","year":2018},"citing_paper":{"arxiv_id":"2412.11183","last_updated":"2025-08-22T08:05:31Z","snapshot_observed_at":"2026-08-11T15:10:22.471125Z","submitted_at":"2024-12-15T13:26:51Z","title":"OccScene: Semantic Occupancy-based Cross-task Mutual Learning for 3D Scene Generation","version":2},"reference_index":88,"source":"pdf_text","source_observed_at":"2026-08-11T15:17:38.940884Z"},"links":{"citing_paper":"/paper/2412.11183"},"observation_digest":"sha256:52c83faf3e7f8c48c34e75c2e13802739aae5c55e58f2ef46292dbe51b82f15f","observation_id":"6460a67b-08ad-4d58-a378-6ad639f04771","resolution":{"observed_at":"2026-08-11T15:17:39.278892Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T15:17:39.261529Z","title":"A review of recurrent neural network-based methods in computational physiology,","venue":null,"work_id":"09508dbb-d800-45b6-94bf-2d1501bc1642","year":2022},"citing_paper":{"arxiv_id":"2412.11183","last_updated":"2025-08-22T08:05:31Z","snapshot_observed_at":"2026-08-11T15:10:22.471125Z","submitted_at":"2024-12-15T13:26:51Z","title":"OccScene: Semantic Occupancy-based Cross-task Mutual Learning for 3D Scene Generation","version":2},"reference_index":89,"source":"pdf_text","source_observed_at":"2026-08-11T15:17:38.944640Z"},"links":{"citing_paper":"/paper/2412.11183"},"observation_digest":"sha256:1d3692de9d737223c85c26db57421d0fd977e52801d3d33a4fc93df18a21334f","observation_id":"d09b5847-e5e4-4d6d-8237-e968c5c3f317","resolution":{"observed_at":"2026-08-11T15:17:39.266023Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T15:17:39.247230Z","title":"He was a Sr","venue":null,"work_id":"9a91e83a-19a9-4035-a526-ec62a8be0ece","year":2014},"citing_paper":{"arxiv_id":"2412.11183","last_updated":"2025-08-22T08:05:31Z","snapshot_observed_at":"2026-08-11T15:10:22.471125Z","submitted_at":"2024-12-15T13:26:51Z","title":"OccScene: Semantic Occupancy-based Cross-task Mutual Learning for 3D Scene Generation","version":2},"reference_index":2021,"source":"pdf_text","source_observed_at":"2026-08-11T15:17:38.949058Z"},"links":{"citing_paper":"/paper/2412.11183"},"observation_digest":"sha256:a4a7198c99b7393b55f702b762f4285c02741bfa103f5f66ae41861f20a70b27","observation_id":"80664b1a-2c01-449c-8355-7b4047b1ffa3","resolution":{"observed_at":"2026-08-11T15:17:39.251691Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}}],"paper":{"arxiv_id":"2412.11183","last_updated":"2025-08-22T08:05:31Z","latest_version":2,"primary_category":"cs.CV","snapshot_observed_at":"2026-08-11T15:10:22.471125Z","submitted_at":"2024-12-15T13:26:51Z","title":"OccScene: Semantic Occupancy-based Cross-task Mutual Learning for 3D Scene Generation"},"reference_resolution":{"displayed":90,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":38,"verified_exact":1,"verified_fuzzy":51},"total_outbound_references":90},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"thesis":"As of 13 August 2026, this Paper Citation Record lists 90 of 90 outbound references and 1 inbound Pith citation observation for arXiv:2412.11183."}