{"as_of":"2026-08-18T23:25:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:000d93fe2655c9f94be045381fb56d7d1b69bb2a1ff85838474ab4b113952276","coverage":[{"denominator":46,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":46,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-16T10:22:31.483090Z","state":"measured"},{"denominator":48,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":48,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-18T06:34:40.430872+00:00","state":"measured"},{"denominator":2,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":2,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-05T06:04:09.323363Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"arxiv_reference","source_observed_at":"2026-07-04T02:59:26.729853Z","state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2504.18448","last_updated":"2025-04-25T16:01:48Z","snapshot_observed_at":"2026-08-18T02:06:37.102477Z","submitted_at":"2025-04-25T16:01:48Z","title":"NoiseController: Towards Consistent Multi-view Video Generation via Noise Decomposition and Collaboration","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2504.18448","snapshot_observed_at":"2026-08-05T06:04:09.323363Z","title":"NoiseController: Towards consistent multi-view video generation via noise decomposition and collaboration.arXiv preprint arXiv:2504.18448, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2509.07996","last_updated":"2026-07-20T17:34:32Z","snapshot_observed_at":"2026-08-17T01:42:27.928087Z","submitted_at":"2025-09-04T17:59:58Z","title":"3D and 4D World Modeling: A Survey","version":4},"reference_index":47,"source":"pdf_text","source_observed_at":"2026-08-05T06:04:09.323363Z"},"links":{"cited_paper":"/paper/2504.18448","citing_paper":"/paper/2509.07996"},"observation_digest":"sha256:e549b422393180ecbdcf8be5e4ec52638ed62a933d0b23d64bf8d87088f15170","observation_id":"a43eee80-a68e-45b3-a03a-38fe8219cbdb","resolution":{"observed_at":"2026-08-05T06:04:09.323363Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2504.18448","last_updated":"2025-04-25T16:01:48Z","snapshot_observed_at":"2026-08-18T02:06:37.102477Z","submitted_at":"2025-04-25T16:01:48Z","title":"NoiseController: Towards Consistent Multi-view Video Generation via Noise Decomposition and Collaboration","version":1},"cited_work":{"arxiv_id":"2504.18448","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2504.18448","snapshot_observed_at":"2026-07-04T02:59:26.729853Z","title":"arXiv preprint arXiv:2504.18448 (2025) 4","venue":null,"work_id":"32ef1324-1a68-4e8a-8951-c5c9cfe1a1e6","year":2025},"citing_paper":{"arxiv_id":"2606.20110","last_updated":"2026-06-18T11:34:26Z","snapshot_observed_at":"2026-08-01T19:05:47.270913Z","submitted_at":"2026-06-18T11:34:26Z","title":"FrozenDrive: Zero-Shot Text-Guided Driving Scene Generation and Data Augmentation with Parameter-Free Frozen Diffusion Model","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-06-26T18:34:56.810124Z"},"links":{"cited_paper":"/paper/2504.18448","citing_paper":"/paper/2606.20110"},"observation_digest":"sha256:830ac8acab87a7fc4ea38790bd8452572240227ebdf39d07d358d6026ffbae1c","observation_id":"1eee3027-bf81-4e10-ab46-b57cdc7ef93c","resolution":{"observed_at":"2026-07-04T02:59:26.731902Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}}],"links":{"evidence":"/evidence","html":"/paper/2504.18448/citation-record","integrity":"/paper/2504.18448/integrity","json":"/paper/2504.18448/citation-record.json","paper":"/paper/2504.18448"},"outbound":[{"citation":{"cited_paper":{"arxiv_id":"2401.12945","last_updated":"2024-02-05T16:36:30Z","snapshot_observed_at":"2026-08-16T14:25:07.068786Z","submitted_at":"2024-01-23T18:05:25Z","title":"Lumiere: A Space-Time Diffusion Model for Video Generation","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2401.12945","snapshot_observed_at":"2026-08-16T10:22:31.308804Z","title":"Lumiere: A space-time diffusion model for video generation","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2504.18448","last_updated":"2025-04-25T16:01:48Z","snapshot_observed_at":"2026-08-18T02:06:37.102477Z","submitted_at":"2025-04-25T16:01:48Z","title":"NoiseController: Towards Consistent Multi-view Video Generation via Noise Decomposition and Collaboration","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-16T10:22:31.308804Z"},"links":{"cited_paper":"/paper/2401.12945","citing_paper":"/paper/2504.18448"},"observation_digest":"sha256:b4c204a809dfc2032fbe53cfc9c9078b451761546d240530e2b49a1ba9e6d776","observation_id":"c9177a2b-e278-4a69-98e0-1af2a9df47df","resolution":{"observed_at":"2026-08-16T10:22:31.308804Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T10:22:31.313877Z","title":"Align your latents: High-resolution video synthesis with la- tent diffusion models","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2504.18448","last_updated":"2025-04-25T16:01:48Z","snapshot_observed_at":"2026-08-18T02:06:37.102477Z","submitted_at":"2025-04-25T16:01:48Z","title":"NoiseController: Towards Consistent Multi-view Video Generation via Noise Decomposition and Collaboration","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-16T10:22:31.313877Z"},"links":{"citing_paper":"/paper/2504.18448"},"observation_digest":"sha256:6df21527e26d17372733e0562360b7f05185ceb8667879df7c70310c7fe9d596","observation_id":"6ea2bb5e-d4ae-4ab8-a741-a2df09aa4f65","resolution":{"observed_at":"2026-08-16T10:22:31.313877Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T10:22:31.317703Z","title":"nuscenes: A multi- modal dataset for autonomous driving","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2504.18448","last_updated":"2025-04-25T16:01:48Z","snapshot_observed_at":"2026-08-18T02:06:37.102477Z","submitted_at":"2025-04-25T16:01:48Z","title":"NoiseController: Towards Consistent Multi-view Video Generation via Noise Decomposition and Collaboration","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-16T10:22:31.317703Z"},"links":{"citing_paper":"/paper/2504.18448"},"observation_digest":"sha256:fd419b81909fe34774115b8bbf08b47e32e133112d312d89e854eb3995d8702c","observation_id":"71ce831f-0bee-498b-bb6f-12e426dce2f0","resolution":{"observed_at":"2026-08-16T10:22:31.317703Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T10:22:32.016261Z","title":"MagicDriveDiT: High-resolution long video generation for autonomous driving with adaptive con- trol, 2024","venue":null,"work_id":"cfb760ef-110e-411c-86c9-0688d4f2f3bd","year":2024},"citing_paper":{"arxiv_id":"2504.18448","last_updated":"2025-04-25T16:01:48Z","snapshot_observed_at":"2026-08-18T02:06:37.102477Z","submitted_at":"2025-04-25T16:01:48Z","title":"NoiseController: Towards Consistent Multi-view Video Generation via Noise Decomposition and Collaboration","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-16T10:22:31.322008Z"},"links":{"citing_paper":"/paper/2504.18448"},"observation_digest":"sha256:b27914e77d61dadde3524e3e5067dd6c0a016f1652f0c65e638d54618bf86ad5","observation_id":"14232f35-ce5a-4cec-b1e6-dbbe6d96ff8a","resolution":{"observed_at":"2026-08-16T10:22:32.020354Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T10:22:32.003346Z","title":"MagicDrive: Street view generation with diverse 3d geometry control","venue":null,"work_id":"66500084-c91c-43a2-a7f9-7ad66fda80db","year":2024},"citing_paper":{"arxiv_id":"2504.18448","last_updated":"2025-04-25T16:01:48Z","snapshot_observed_at":"2026-08-18T02:06:37.102477Z","submitted_at":"2025-04-25T16:01:48Z","title":"NoiseController: Towards Consistent Multi-view Video Generation via Noise Decomposition and Collaboration","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-16T10:22:31.325598Z"},"links":{"citing_paper":"/paper/2504.18448"},"observation_digest":"sha256:d1b660c8c63e60417ef759e458ab5b406ccf48f1fa9b0287b1b02b02d0734bb4","observation_id":"5756b66b-8b60-4f7a-8456-f32310d08cf9","resolution":{"observed_at":"2026-08-16T10:22:32.007645Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T10:22:31.991280Z","title":"Preserve your own correlation: A noise prior for video diffusion models","venue":null,"work_id":"aa680c29-5c95-4883-a447-5d76025540db","year":2023},"citing_paper":{"arxiv_id":"2504.18448","last_updated":"2025-04-25T16:01:48Z","snapshot_observed_at":"2026-08-18T02:06:37.102477Z","submitted_at":"2025-04-25T16:01:48Z","title":"NoiseController: Towards Consistent Multi-view Video Generation via Noise Decomposition and Collaboration","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-16T10:22:31.330023Z"},"links":{"citing_paper":"/paper/2504.18448"},"observation_digest":"sha256:2f6a664afd0347de3b47e0c6a3cdf2dbad026bf97af12196a044988ea99478c0","observation_id":"f96a7fe5-5b3b-46b3-bc15-d3799aa8f83e","resolution":{"observed_at":"2026-08-16T10:22:31.995510Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T10:22:31.334139Z","title":"Gans trained by a two time-scale update rule converge to a local nash equilibrium","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2504.18448","last_updated":"2025-04-25T16:01:48Z","snapshot_observed_at":"2026-08-18T02:06:37.102477Z","submitted_at":"2025-04-25T16:01:48Z","title":"NoiseController: Towards Consistent Multi-view Video Generation via Noise Decomposition and Collaboration","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-16T10:22:31.334139Z"},"links":{"citing_paper":"/paper/2504.18448"},"observation_digest":"sha256:9fe24a80a8f15cd426971fe731d31a751c8bcdacf5d46f2af574c871ebae206f","observation_id":"d1d8e286-74bf-4a1a-a7e5-110f7835ea69","resolution":{"observed_at":"2026-08-16T10:22:31.334139Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T10:22:31.972167Z","title":"Fiery: Future instance prediction in bird’s-eye view from surround monocular cameras","venue":null,"work_id":"39a3b5af-e89f-4e52-bafc-8ca39edd27d2","year":2021},"citing_paper":{"arxiv_id":"2504.18448","last_updated":"2025-04-25T16:01:48Z","snapshot_observed_at":"2026-08-18T02:06:37.102477Z","submitted_at":"2025-04-25T16:01:48Z","title":"NoiseController: Towards Consistent Multi-view Video Generation via Noise Decomposition and Collaboration","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-16T10:22:31.339624Z"},"links":{"citing_paper":"/paper/2504.18448"},"observation_digest":"sha256:e5f5a405c741c64e0d2cd69febef9d7fd1a60e333b1adc73635a1de7f3f35f4a","observation_id":"0d3876bd-7d5e-4250-93b9-3a9db2e16a32","resolution":{"observed_at":"2026-08-16T10:22:31.975802Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2403.19438","last_updated":"2024-12-26T10:33:31Z","snapshot_observed_at":"2026-08-17T11:56:12.119196Z","submitted_at":"2024-03-28T14:07:13Z","title":"SubjectDrive: Scaling Generative Data in Autonomous Driving via Subject Control","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2403.19438","snapshot_observed_at":"2026-08-16T10:22:31.343351Z","title":"Subjectdrive: Scaling generative data in autonomous driving via subject control","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2504.18448","last_updated":"2025-04-25T16:01:48Z","snapshot_observed_at":"2026-08-18T02:06:37.102477Z","submitted_at":"2025-04-25T16:01:48Z","title":"NoiseController: Towards Consistent Multi-view Video Generation via Noise Decomposition and Collaboration","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-16T10:22:31.343351Z"},"links":{"cited_paper":"/paper/2403.19438","citing_paper":"/paper/2504.18448"},"observation_digest":"sha256:65ef2b2f0aa36e769586b86779b84c8378e18740c96c45956940eb4734057958","observation_id":"71c6f559-7de3-4b1e-b9db-e86c1e339003","resolution":{"observed_at":"2026-08-16T10:22:31.343351Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T10:22:31.960264Z","title":"The lot- tery ticket hypothesis in denoising: Towards semantic-driven initialization","venue":null,"work_id":"c17b3c45-ca86-4223-9783-563368048b51","year":2024},"citing_paper":{"arxiv_id":"2504.18448","last_updated":"2025-04-25T16:01:48Z","snapshot_observed_at":"2026-08-18T02:06:37.102477Z","submitted_at":"2025-04-25T16:01:48Z","title":"NoiseController: Towards Consistent Multi-view Video Generation via Noise Decomposition and Collaboration","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-16T10:22:31.347594Z"},"links":{"citing_paper":"/paper/2504.18448"},"observation_digest":"sha256:44324b1b7dfef128ee165590268d4d26a3ff16b5785ec61269a19f63e3c55a46","observation_id":"edcfe462-4378-44e8-bb21-3a2f6277ef7e","resolution":{"observed_at":"2026-08-16T10:22:31.964376Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2312.00651","last_updated":"2024-03-20T17:28:02Z","snapshot_observed_at":"2026-08-18T16:27:56.681198Z","submitted_at":"2023-12-01T15:24:38Z","title":"TrackDiffusion: Tracklet-Conditioned Video Generation via Diffusion Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2312.00651","snapshot_observed_at":"2026-08-16T10:22:31.351376Z","title":"Trackdiffusion: Tracklet-conditioned video generation via diffusion models","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2504.18448","last_updated":"2025-04-25T16:01:48Z","snapshot_observed_at":"2026-08-18T02:06:37.102477Z","submitted_at":"2025-04-25T16:01:48Z","title":"NoiseController: Towards Consistent Multi-view Video Generation via Noise Decomposition and Collaboration","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-16T10:22:31.351376Z"},"links":{"cited_paper":"/paper/2312.00651","citing_paper":"/paper/2504.18448"},"observation_digest":"sha256:dfe7c88359c8ec35ddd283c04583b1a6c97629b0fb6d33c0c8c786f5e18045a5","observation_id":"04c17717-b57e-4f7d-8f36-f1989bf3e0b0","resolution":{"observed_at":"2026-08-16T10:22:31.351376Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2403.02827","last_updated":"2024-03-05T09:57:47Z","snapshot_observed_at":"2026-08-16T14:12:43.972557Z","submitted_at":"2024-03-05T09:57:47Z","title":"Tuning-Free Noise Rectification for High Fidelity Image-to-Video Generation","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2403.02827","snapshot_observed_at":"2026-08-16T10:22:31.355652Z","title":"Tuning-free noise rectification for high fidelity image-to-video generation","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2504.18448","last_updated":"2025-04-25T16:01:48Z","snapshot_observed_at":"2026-08-18T02:06:37.102477Z","submitted_at":"2025-04-25T16:01:48Z","title":"NoiseController: Towards Consistent Multi-view Video Generation via Noise Decomposition and Collaboration","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-16T10:22:31.355652Z"},"links":{"cited_paper":"/paper/2403.02827","citing_paper":"/paper/2504.18448"},"observation_digest":"sha256:b77947db49263235256b70bea9edfc9d36a7af31521704f1e958d3b98e2122e2","observation_id":"f1a6db1c-9431-4494-9283-40e80966ef35","resolution":{"observed_at":"2026-08-16T10:22:31.355652Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2310.07771","last_updated":"2023-10-11T18:00:08Z","snapshot_observed_at":"2026-08-16T14:52:57.311270Z","submitted_at":"2023-10-11T18:00:08Z","title":"DrivingDiffusion: Layout-Guided multi-view driving scene video generation with latent diffusion model","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2310.07771","snapshot_observed_at":"2026-08-16T10:22:31.359588Z","title":"Drivingdiffusion: Layout-guided multi-view driving scene video generation with latent diffusion model","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2504.18448","last_updated":"2025-04-25T16:01:48Z","snapshot_observed_at":"2026-08-18T02:06:37.102477Z","submitted_at":"2025-04-25T16:01:48Z","title":"NoiseController: Towards Consistent Multi-view Video Generation via Noise Decomposition and Collaboration","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-16T10:22:31.359588Z"},"links":{"cited_paper":"/paper/2310.07771","citing_paper":"/paper/2504.18448"},"observation_digest":"sha256:99427af5aa0b0663efe30b9aeaced16dc61a1f39e4918803d6e3787c078cb4f9","observation_id":"f73ae14c-e5ad-47a2-9a03-1d4fbe4befc8","resolution":{"observed_at":"2026-08-16T10:22:31.359588Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T10:22:31.949449Z","title":"Bevdepth: Acquisition of reliable depth for multi-view 3d object detec- tion","venue":null,"work_id":"d911489c-ad0a-4d05-a342-9f04bed3b1c2","year":2023},"citing_paper":{"arxiv_id":"2504.18448","last_updated":"2025-04-25T16:01:48Z","snapshot_observed_at":"2026-08-18T02:06:37.102477Z","submitted_at":"2025-04-25T16:01:48Z","title":"NoiseController: Towards Consistent Multi-view Video Generation via Noise Decomposition and Collaboration","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-16T10:22:31.363755Z"},"links":{"citing_paper":"/paper/2504.18448"},"observation_digest":"sha256:15b032775c243356e1b188aca6807660bd535f2b846a3b5f32f369cfa67f7d75","observation_id":"c1bf03c6-4a1f-4db4-9757-786569f53d8f","resolution":{"observed_at":"2026-08-16T10:22:31.953293Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T10:22:31.938456Z","title":"Bevformer: Learning bird’s-eye-view representation from multi-camera images via spatiotemporal transformers","venue":null,"work_id":"fdafbc6b-ed24-4539-acb4-05b722c364e9","year":2022},"citing_paper":{"arxiv_id":"2504.18448","last_updated":"2025-04-25T16:01:48Z","snapshot_observed_at":"2026-08-18T02:06:37.102477Z","submitted_at":"2025-04-25T16:01:48Z","title":"NoiseController: Towards Consistent Multi-view Video Generation via Noise Decomposition and Collaboration","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-16T10:22:31.367649Z"},"links":{"citing_paper":"/paper/2504.18448"},"observation_digest":"sha256:33085f3283bd23e9c624dfe2dff54de439f66ba9918cce1474a62f65609d66a9","observation_id":"86847842-b51d-47bd-b3be-251594aaaacc","resolution":{"observed_at":"2026-08-16T10:22:31.942276Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T10:22:31.927363Z","title":"Bevfusion: Multi- task multi-sensor fusion with unified bird’s-eye view repre- sentation","venue":null,"work_id":"9a6d1ffc-b179-4c45-a313-32bc0f194ef8","year":2023},"citing_paper":{"arxiv_id":"2504.18448","last_updated":"2025-04-25T16:01:48Z","snapshot_observed_at":"2026-08-18T02:06:37.102477Z","submitted_at":"2025-04-25T16:01:48Z","title":"NoiseController: Towards Consistent Multi-view Video Generation via Noise Decomposition and Collaboration","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-16T10:22:31.371488Z"},"links":{"citing_paper":"/paper/2504.18448"},"observation_digest":"sha256:910df437e5cbd950094e4ef3528bb73e40efbd895b1bd832941a41e743bfc68c","observation_id":"32c9faf7-ae24-45e1-ac4c-9180f3f3fbfb","resolution":{"observed_at":"2026-08-16T10:22:31.931277Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2312.02934","last_updated":"2024-08-08T04:42:52Z","snapshot_observed_at":"2026-08-16T14:37:24.688257Z","submitted_at":"2023-12-05T18:05:14Z","title":"WoVoGen: World Volume-aware Diffusion for Controllable Multi-camera Driving Scene Generation","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2312.02934","snapshot_observed_at":"2026-08-16T10:22:31.375347Z","title":"Wovogen: World volume-aware diffusion for control- lable multi-camera driving scene generation","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2504.18448","last_updated":"2025-04-25T16:01:48Z","snapshot_observed_at":"2026-08-18T02:06:37.102477Z","submitted_at":"2025-04-25T16:01:48Z","title":"NoiseController: Towards Consistent Multi-view Video Generation via Noise Decomposition and Collaboration","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-16T10:22:31.375347Z"},"links":{"cited_paper":"/paper/2312.02934","citing_paper":"/paper/2504.18448"},"observation_digest":"sha256:2e97e845895ff5d9439636c6f050fbf96ed5f5342c4c19332431ddd5347e881d","observation_id":"363a24e9-25ee-4479-86ca-fdb18d48508c","resolution":{"observed_at":"2026-08-16T10:22:31.375347Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T10:22:31.916281Z","title":null,"venue":null,"work_id":"9b14d667-7e67-42bf-8b6d-03e17316f2ad","year":2023},"citing_paper":{"arxiv_id":"2504.18448","last_updated":"2025-04-25T16:01:48Z","snapshot_observed_at":"2026-08-18T02:06:37.102477Z","submitted_at":"2025-04-25T16:01:48Z","title":"NoiseController: Towards Consistent Multi-view Video Generation via Noise Decomposition and Collaboration","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-16T10:22:31.379651Z"},"links":{"citing_paper":"/paper/2504.18448"},"observation_digest":"sha256:99446fc289d3d1c27e89d77bb65fce735d213c707f1285c3b63d66488ad0567f","observation_id":"2a54e3d6-4a76-4ea5-8258-981c86ff64cc","resolution":{"observed_at":"2026-08-16T10:22:31.920041Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T10:22:31.903874Z","title":"Unleashing generalization of end-to-end autonomous driving with controllable long video generation, 2024","venue":null,"work_id":"56b90d42-df96-41a9-80aa-34125602ce0e","year":2024},"citing_paper":{"arxiv_id":"2504.18448","last_updated":"2025-04-25T16:01:48Z","snapshot_observed_at":"2026-08-18T02:06:37.102477Z","submitted_at":"2025-04-25T16:01:48Z","title":"NoiseController: Towards Consistent Multi-view Video Generation via Noise Decomposition and Collaboration","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-16T10:22:31.383336Z"},"links":{"citing_paper":"/paper/2504.18448"},"observation_digest":"sha256:c5bd6a4f123fee5585cc1ff75a5387bcb7ef742beeeb5390cde05fc7d6ef0030","observation_id":"9f29f059-016b-4c96-99dc-316f0568a710","resolution":{"observed_at":"2026-08-16T10:22:31.908180Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T10:22:31.892596Z","title":"Guided image synthesis via initial image editing in diffusion model","venue":null,"work_id":"33b7445a-5cc0-45d3-bc5f-d46d767d250a","year":2023},"citing_paper":{"arxiv_id":"2504.18448","last_updated":"2025-04-25T16:01:48Z","snapshot_observed_at":"2026-08-18T02:06:37.102477Z","submitted_at":"2025-04-25T16:01:48Z","title":"NoiseController: Towards Consistent Multi-view Video Generation via Noise Decomposition and Collaboration","version":1},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-16T10:22:31.386976Z"},"links":{"citing_paper":"/paper/2504.18448"},"observation_digest":"sha256:5e56c89a2c582d953376dbcd834084ceec40b454ff2dba640b50d2501f2f714d","observation_id":"45fce7da-9c56-4900-8b34-999e6f8a4957","resolution":{"observed_at":"2026-08-16T10:22:31.896604Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T10:22:31.881215Z","title":"Lift, splat, shoot: Encoding images from arbitrary camera rigs by implicitly unproject- ing to 3d","venue":null,"work_id":"e0b13fc2-dd23-4543-a9b6-addf060012aa","year":2020},"citing_paper":{"arxiv_id":"2504.18448","last_updated":"2025-04-25T16:01:48Z","snapshot_observed_at":"2026-08-18T02:06:37.102477Z","submitted_at":"2025-04-25T16:01:48Z","title":"NoiseController: Towards Consistent Multi-view Video Generation via Noise Decomposition and Collaboration","version":1},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-16T10:22:31.390667Z"},"links":{"citing_paper":"/paper/2504.18448"},"observation_digest":"sha256:cefcf96faa62ec401abf2261b2142e6926b910dee30778ca593547508f95ce51","observation_id":"9badb362-7abb-4959-8e21-c36ce6891799","resolution":{"observed_at":"2026-08-16T10:22:31.884957Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2406.16863","last_updated":"2024-06-24T17:59:56Z","snapshot_observed_at":"2026-08-16T13:40:01.824560Z","submitted_at":"2024-06-24T17:59:56Z","title":"FreeTraj: Tuning-Free Trajectory Control in Video Diffusion Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2406.16863","snapshot_observed_at":"2026-08-16T10:22:31.394053Z","title":"Freetraj: Tuning-free tra- jectory control in video diffusion models","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2504.18448","last_updated":"2025-04-25T16:01:48Z","snapshot_observed_at":"2026-08-18T02:06:37.102477Z","submitted_at":"2025-04-25T16:01:48Z","title":"NoiseController: Towards Consistent Multi-view Video Generation via Noise Decomposition and Collaboration","version":1},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-16T10:22:31.394053Z"},"links":{"cited_paper":"/paper/2406.16863","citing_paper":"/paper/2504.18448"},"observation_digest":"sha256:e00fab70ddb0ebed359c71c01bffadc8170091dd0db071c589eafe1d1e9f98f4","observation_id":"b752c812-129e-4f0b-a9a9-2330f3a87181","resolution":{"observed_at":"2026-08-16T10:22:31.394053Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T10:22:31.868325Z","title":"Freenoise: Tuning-free longer video diffusion via noise rescheduling, 2023","venue":null,"work_id":"628d154f-03ca-45dc-b61c-d14d2936d2a2","year":2023},"citing_paper":{"arxiv_id":"2504.18448","last_updated":"2025-04-25T16:01:48Z","snapshot_observed_at":"2026-08-18T02:06:37.102477Z","submitted_at":"2025-04-25T16:01:48Z","title":"NoiseController: Towards Consistent Multi-view Video Generation via Noise Decomposition and Collaboration","version":1},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-16T10:22:31.397860Z"},"links":{"citing_paper":"/paper/2504.18448"},"observation_digest":"sha256:9c8c4e24dccd57ad8feaefa5ac7a8569500f42e0fb885dc9044cb5d9dd416909","observation_id":"b76837af-4abe-49cb-89b5-4d1b3bfdad77","resolution":{"observed_at":"2026-08-16T10:22:31.872366Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T10:22:31.856891Z","title":"High-resolution image 9 synthesis with latent diffusion models","venue":null,"work_id":"8090a5fe-86ab-472f-95f7-a4aec065896e","year":2022},"citing_paper":{"arxiv_id":"2504.18448","last_updated":"2025-04-25T16:01:48Z","snapshot_observed_at":"2026-08-18T02:06:37.102477Z","submitted_at":"2025-04-25T16:01:48Z","title":"NoiseController: Towards Consistent Multi-view Video Generation via Noise Decomposition and Collaboration","version":1},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-16T10:22:31.401433Z"},"links":{"citing_paper":"/paper/2504.18448"},"observation_digest":"sha256:7535c27c18518e3660b260fe50fe93a4c24f5cf3b3129bae6cd1c8224d7aa750","observation_id":"fbf21339-209a-4909-b32b-72782b62c64c","resolution":{"observed_at":"2026-08-16T10:22:31.860862Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T10:22:31.844590Z","title":"Dragdiffusion: Harnessing diffusion models for interactive point-based image editing","venue":null,"work_id":"551f3b36-d47f-4d6f-882a-2c564cb9fbdd","year":2024},"citing_paper":{"arxiv_id":"2504.18448","last_updated":"2025-04-25T16:01:48Z","snapshot_observed_at":"2026-08-18T02:06:37.102477Z","submitted_at":"2025-04-25T16:01:48Z","title":"NoiseController: Towards Consistent Multi-view Video Generation via Noise Decomposition and Collaboration","version":1},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-08-16T10:22:31.405140Z"},"links":{"citing_paper":"/paper/2504.18448"},"observation_digest":"sha256:6e7c0ce6a7a2cc075fea29251ecd7f4aa29d82528e3f592b64cdc4d2737c5789","observation_id":"57a6b389-5a2e-41a2-a89a-f07dff0b377a","resolution":{"observed_at":"2026-08-16T10:22:31.848772Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T10:22:31.830206Z","title":"Noisecollage: A layout-aware text-to-image diffusion model based on noise cropping and merging","venue":null,"work_id":"294c28fe-eb83-40af-b840-329d57077113","year":2024},"citing_paper":{"arxiv_id":"2504.18448","last_updated":"2025-04-25T16:01:48Z","snapshot_observed_at":"2026-08-18T02:06:37.102477Z","submitted_at":"2025-04-25T16:01:48Z","title":"NoiseController: Towards Consistent Multi-view Video Generation via Noise Decomposition and Collaboration","version":1},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-08-16T10:22:31.408520Z"},"links":{"citing_paper":"/paper/2504.18448"},"observation_digest":"sha256:83478bba9778a867942bf1780407f3d0a5056d3350614d25a8234196dcf2e758","observation_id":"8049703e-4868-4adc-93e0-4b3319894fa3","resolution":{"observed_at":"2026-08-16T10:22:31.835670Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T10:22:31.816796Z","title":"Make- a-video: Text-to-video generation without text-video data","venue":null,"work_id":"45f770b4-4714-4d51-b4a0-f1be32fc8b08","year":2023},"citing_paper":{"arxiv_id":"2504.18448","last_updated":"2025-04-25T16:01:48Z","snapshot_observed_at":"2026-08-18T02:06:37.102477Z","submitted_at":"2025-04-25T16:01:48Z","title":"NoiseController: Towards Consistent Multi-view Video Generation via Noise Decomposition and Collaboration","version":1},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-08-16T10:22:31.411894Z"},"links":{"citing_paper":"/paper/2504.18448"},"observation_digest":"sha256:7e3cd9faaca8bce5a7f86cccbfb5a864b2d50d0fd84998833749e28fdb8e5000","observation_id":"90347c3d-7db6-438e-860d-b598df0afce5","resolution":{"observed_at":"2026-08-16T10:22:31.820778Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T10:22:31.803805Z","title":"Street- view image generation from a bird’s-eye view layout","venue":null,"work_id":"d9ef85b6-b0b8-4d06-a43f-dd0b14a0eece","year":2024},"citing_paper":{"arxiv_id":"2504.18448","last_updated":"2025-04-25T16:01:48Z","snapshot_observed_at":"2026-08-18T02:06:37.102477Z","submitted_at":"2025-04-25T16:01:48Z","title":"NoiseController: Towards Consistent Multi-view Video Generation via Noise Decomposition and Collaboration","version":1},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-08-16T10:22:31.415672Z"},"links":{"citing_paper":"/paper/2504.18448"},"observation_digest":"sha256:0616f0566f1b01c626b2bc624ec8fb51b451f40501fc0d2b79b29101046312ee","observation_id":"464f0f2a-1cb5-4be4-afb5-39e90a53f6c7","resolution":{"observed_at":"2026-08-16T10:22:31.808253Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1812.01717","last_updated":"2019-03-27T16:43:17Z","snapshot_observed_at":"2026-08-18T04:00:09.136122Z","submitted_at":"2018-12-03T03:57:42Z","title":"Towards Accurate Generative Models of Video: A New Metric & Challenges","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1812.01717","snapshot_observed_at":"2026-08-16T10:22:31.419295Z","title":"To- wards accurate generative models of video: A new metric & challenges","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2504.18448","last_updated":"2025-04-25T16:01:48Z","snapshot_observed_at":"2026-08-18T02:06:37.102477Z","submitted_at":"2025-04-25T16:01:48Z","title":"NoiseController: Towards Consistent Multi-view Video Generation via Noise Decomposition and Collaboration","version":1},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-08-16T10:22:31.419295Z"},"links":{"cited_paper":"/paper/1812.01717","citing_paper":"/paper/2504.18448"},"observation_digest":"sha256:2eddcab4b9327a885120697f2411e564259aabea82c268bdec5c850ecc4bb5f5","observation_id":"6b1835e0-11b5-41d3-9e8c-c8c1278ced95","resolution":{"observed_at":"2026-08-16T10:22:31.419295Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2303.11926","last_updated":"2023-06-07T08:08:16Z","snapshot_observed_at":"2026-08-18T21:27:45.447412Z","submitted_at":"2023-03-21T15:19:20Z","title":"Exploring Object-Centric Temporal Modeling for Efficient Multi-View 3D Object Detection","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2303.11926","snapshot_observed_at":"2026-08-16T10:22:31.422876Z","title":"Exploring object-centric temporal modeling for efficient multi-view 3d object detection","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2504.18448","last_updated":"2025-04-25T16:01:48Z","snapshot_observed_at":"2026-08-18T02:06:37.102477Z","submitted_at":"2025-04-25T16:01:48Z","title":"NoiseController: Towards Consistent Multi-view Video Generation via Noise Decomposition and Collaboration","version":1},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-08-16T10:22:31.422876Z"},"links":{"cited_paper":"/paper/2303.11926","citing_paper":"/paper/2504.18448"},"observation_digest":"sha256:fd80c315b5a4d0a037bf44922225fc9863110dd2892230be261da29bf3ad5e0d","observation_id":"db7f083f-3b0e-4d85-8f99-ba0f0531122b","resolution":{"observed_at":"2026-08-16T10:22:31.422876Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2309.09777","last_updated":"2023-11-27T05:09:29Z","snapshot_observed_at":"2026-08-16T14:59:48.218608Z","submitted_at":"2023-09-18T13:58:42Z","title":"DriveDreamer: Towards Real-world-driven World Models for Autonomous Driving","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2309.09777","snapshot_observed_at":"2026-08-16T10:22:31.426485Z","title":"Drivedreamer: Towards real-world- driven world models for autonomous driving","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2504.18448","last_updated":"2025-04-25T16:01:48Z","snapshot_observed_at":"2026-08-18T02:06:37.102477Z","submitted_at":"2025-04-25T16:01:48Z","title":"NoiseController: Towards Consistent Multi-view Video Generation via Noise Decomposition and Collaboration","version":1},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-08-16T10:22:31.426485Z"},"links":{"cited_paper":"/paper/2309.09777","citing_paper":"/paper/2504.18448"},"observation_digest":"sha256:728deff615f567386d91f6173cc3ac00931ca155023e5166e987d36898852bb8","observation_id":"1f3077c1-1e82-44fc-86ec-708e3207a1c1","resolution":{"observed_at":"2026-08-16T10:22:31.426485Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T10:22:31.790309Z","title":"Driving into the future: Multiview visual forecasting and planning with world model for au- tonomous driving","venue":null,"work_id":"23e775fb-7402-4fbd-b419-7dbbe0bc16a7","year":2024},"citing_paper":{"arxiv_id":"2504.18448","last_updated":"2025-04-25T16:01:48Z","snapshot_observed_at":"2026-08-18T02:06:37.102477Z","submitted_at":"2025-04-25T16:01:48Z","title":"NoiseController: Towards Consistent Multi-view Video Generation via Noise Decomposition and Collaboration","version":1},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-08-16T10:22:31.430163Z"},"links":{"citing_paper":"/paper/2504.18448"},"observation_digest":"sha256:ea03978be32750dc06734ebc3be595f89a6e7cef569ce909b5509a29dfc35128","observation_id":"368b778c-508f-4826-bcd3-792f181fba79","resolution":{"observed_at":"2026-08-16T10:22:31.794870Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T10:22:31.775930Z","title":"Panacea+: Panoramic and control- lable video generation for autonomous driving, 2024","venue":null,"work_id":"029b0515-1e4d-416a-a55a-a12681778502","year":2024},"citing_paper":{"arxiv_id":"2504.18448","last_updated":"2025-04-25T16:01:48Z","snapshot_observed_at":"2026-08-18T02:06:37.102477Z","submitted_at":"2025-04-25T16:01:48Z","title":"NoiseController: Towards Consistent Multi-view Video Generation via Noise Decomposition and Collaboration","version":1},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-08-16T10:22:31.433749Z"},"links":{"citing_paper":"/paper/2504.18448"},"observation_digest":"sha256:374f3a781b50ece63906907a3a45e8c99d2fd669a574713b3da931801e67ecc1","observation_id":"4adb4f09-8740-4cca-a792-4d59e210a447","resolution":{"observed_at":"2026-08-16T10:22:31.781943Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T10:22:31.762547Z","title":"Panacea: Panoramic and controllable video generation for autonomous driving","venue":null,"work_id":"87d6d8fb-d57a-41a6-9196-80cc6646e875","year":2024},"citing_paper":{"arxiv_id":"2504.18448","last_updated":"2025-04-25T16:01:48Z","snapshot_observed_at":"2026-08-18T02:06:37.102477Z","submitted_at":"2025-04-25T16:01:48Z","title":"NoiseController: Towards Consistent Multi-view Video Generation via Noise Decomposition and Collaboration","version":1},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-08-16T10:22:31.437454Z"},"links":{"citing_paper":"/paper/2504.18448"},"observation_digest":"sha256:009090386b0ed0a149205378be88f03462e6a2f5e6119cc2e82f314118474186","observation_id":"6e723c61-008e-4038-b5ac-ef7513ec7d3c","resolution":{"observed_at":"2026-08-16T10:22:31.766822Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2406.17758","last_updated":"2024-10-29T11:56:27Z","snapshot_observed_at":"2026-08-16T13:50:54.724883Z","submitted_at":"2024-06-25T17:42:25Z","title":"MotionBooth: Motion-Aware Customized Text-to-Video Generation","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2406.17758","snapshot_observed_at":"2026-08-16T10:22:31.441009Z","title":"Mo- tionbooth: Motion-aware customized text-to-video generation","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2504.18448","last_updated":"2025-04-25T16:01:48Z","snapshot_observed_at":"2026-08-18T02:06:37.102477Z","submitted_at":"2025-04-25T16:01:48Z","title":"NoiseController: Towards Consistent Multi-view Video Generation via Noise Decomposition and Collaboration","version":1},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-08-16T10:22:31.441009Z"},"links":{"cited_paper":"/paper/2406.17758","citing_paper":"/paper/2504.18448"},"observation_digest":"sha256:1b4c297a4d8843ac609c81b8dc402712e4183a03099f8903e54e1efdc5d59de1","observation_id":"189a69fc-ee47-4bd9-82e2-5af173cbba23","resolution":{"observed_at":"2026-08-16T10:22:31.441009Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T10:22:31.444983Z","title":"Tune-a-video: One-shot tuning of image diffusion models for text-to-video generation","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2504.18448","last_updated":"2025-04-25T16:01:48Z","snapshot_observed_at":"2026-08-18T02:06:37.102477Z","submitted_at":"2025-04-25T16:01:48Z","title":"NoiseController: Towards Consistent Multi-view Video Generation via Noise Decomposition and Collaboration","version":1},"reference_index":36,"source":"pdf_text","source_observed_at":"2026-08-16T10:22:31.444983Z"},"links":{"citing_paper":"/paper/2504.18448"},"observation_digest":"sha256:852da74f1f94e5e0e035025db7a082f079b67bb7a00308486bc7440a13e0db99","observation_id":"f086146a-cef7-491e-a3e5-07acfac21ff4","resolution":{"observed_at":"2026-08-16T10:22:31.444983Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2312.07537","last_updated":"2024-07-25T09:10:52Z","snapshot_observed_at":"2026-08-16T14:35:22.220098Z","submitted_at":"2023-12-12T18:59:16Z","title":"FreeInit: Bridging Initialization Gap in Video Diffusion Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2312.07537","snapshot_observed_at":"2026-08-16T10:22:31.448374Z","title":"Freeinit: Bridging initialization gap in video diffu- sion models","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2504.18448","last_updated":"2025-04-25T16:01:48Z","snapshot_observed_at":"2026-08-18T02:06:37.102477Z","submitted_at":"2025-04-25T16:01:48Z","title":"NoiseController: Towards Consistent Multi-view Video Generation via Noise Decomposition and Collaboration","version":1},"reference_index":37,"source":"pdf_text","source_observed_at":"2026-08-16T10:22:31.448374Z"},"links":{"cited_paper":"/paper/2312.07537","citing_paper":"/paper/2504.18448"},"observation_digest":"sha256:8f32201707389bb1370da260ef8abf9264d0d4d9ebcb973e7ad59c75ba49bc5b","observation_id":"901309f9-d17a-4859-8e50-2f864aeb3383","resolution":{"observed_at":"2026-08-16T10:22:31.448374Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2409.05463","last_updated":"2024-09-12T12:32:21Z","snapshot_observed_at":"2026-08-16T13:20:15.790440Z","submitted_at":"2024-09-09T09:43:17Z","title":"DriveScape: Towards High-Resolution Controllable Multi-View Driving Video Generation","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2409.05463","snapshot_observed_at":"2026-08-16T10:22:31.452042Z","title":"Drivescape: To- wards high-resolution controllable multi-view driving video generation","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2504.18448","last_updated":"2025-04-25T16:01:48Z","snapshot_observed_at":"2026-08-18T02:06:37.102477Z","submitted_at":"2025-04-25T16:01:48Z","title":"NoiseController: Towards Consistent Multi-view Video Generation via Noise Decomposition and Collaboration","version":1},"reference_index":38,"source":"pdf_text","source_observed_at":"2026-08-16T10:22:31.452042Z"},"links":{"cited_paper":"/paper/2409.05463","citing_paper":"/paper/2504.18448"},"observation_digest":"sha256:1ae266abf8a6b0ebd6d468d48db8a09a88d83599d47f7b12c04037ef28d31e68","observation_id":"c2a49849-67f1-4481-9162-7073475b071a","resolution":{"observed_at":"2026-08-16T10:22:31.452042Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2308.01661","last_updated":"2023-09-23T06:59:18Z","snapshot_observed_at":"2026-08-16T15:11:06.034826Z","submitted_at":"2023-08-03T09:56:31Z","title":"BEVControl: Accurately Controlling Street-view Elements with Multi-perspective Consistency via BEV Sketch Layout","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2308.01661","snapshot_observed_at":"2026-08-16T10:22:31.455620Z","title":"Bevcontrol: Accurately controlling street-view elements with multi-perspective consistency via bev sketch layout","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2504.18448","last_updated":"2025-04-25T16:01:48Z","snapshot_observed_at":"2026-08-18T02:06:37.102477Z","submitted_at":"2025-04-25T16:01:48Z","title":"NoiseController: Towards Consistent Multi-view Video Generation via Noise Decomposition and Collaboration","version":1},"reference_index":39,"source":"pdf_text","source_observed_at":"2026-08-16T10:22:31.455620Z"},"links":{"cited_paper":"/paper/2308.01661","citing_paper":"/paper/2504.18448"},"observation_digest":"sha256:3fb6f3cd1539af4079755b150c0e4a94b8ab38b062de5350c560e9eae1148064","observation_id":"f586d884-4ea2-4996-ad3d-d113e3414c5e","resolution":{"observed_at":"2026-08-16T10:22:31.455620Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T10:22:31.742603Z","title":"Video instance seg- mentation","venue":null,"work_id":"aa70e5fc-34c2-4248-a4ad-dfed56c2523f","year":2019},"citing_paper":{"arxiv_id":"2504.18448","last_updated":"2025-04-25T16:01:48Z","snapshot_observed_at":"2026-08-18T02:06:37.102477Z","submitted_at":"2025-04-25T16:01:48Z","title":"NoiseController: Towards Consistent Multi-view Video Generation via Noise Decomposition and Collaboration","version":1},"reference_index":40,"source":"pdf_text","source_observed_at":"2026-08-16T10:22:31.459627Z"},"links":{"citing_paper":"/paper/2504.18448"},"observation_digest":"sha256:bf2e830eb77ba412051db56058a4ebc94bbb276683f31635935b51a9f73b64fa","observation_id":"afe8d96b-e0fd-4c50-9945-154dce9b1efa","resolution":{"observed_at":"2026-08-16T10:22:31.746869Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2409.06189","last_updated":"2024-09-11T11:50:27Z","snapshot_observed_at":"2026-08-16T13:19:54.877329Z","submitted_at":"2024-09-10T03:39:08Z","title":"MyGo: Consistent and Controllable Multi-View Driving Video Generation with Camera Control","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2409.06189","snapshot_observed_at":"2026-08-16T10:22:31.463686Z","title":"Mygo: Consistent and controllable multi-view driving video genera- tion with camera control","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2504.18448","last_updated":"2025-04-25T16:01:48Z","snapshot_observed_at":"2026-08-18T02:06:37.102477Z","submitted_at":"2025-04-25T16:01:48Z","title":"NoiseController: Towards Consistent Multi-view Video Generation via Noise Decomposition and Collaboration","version":1},"reference_index":41,"source":"pdf_text","source_observed_at":"2026-08-16T10:22:31.463686Z"},"links":{"cited_paper":"/paper/2409.06189","citing_paper":"/paper/2504.18448"},"observation_digest":"sha256:130b216ff94ef557706f8653fd1b4436ec87b3579da21d8b03dbd1119ef04a68","observation_id":"d1d1bc53-1e07-4fc6-916d-98d4eea00918","resolution":{"observed_at":"2026-08-16T10:22:31.463686Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T10:22:31.467956Z","title":"Controlvideo: Training-free controllable text-to-video generation","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2504.18448","last_updated":"2025-04-25T16:01:48Z","snapshot_observed_at":"2026-08-18T02:06:37.102477Z","submitted_at":"2025-04-25T16:01:48Z","title":"NoiseController: Towards Consistent Multi-view Video Generation via Noise Decomposition and Collaboration","version":1},"reference_index":42,"source":"pdf_text","source_observed_at":"2026-08-16T10:22:31.467956Z"},"links":{"citing_paper":"/paper/2504.18448"},"observation_digest":"sha256:ca60a45d807b61e0f11d47bdc4fa2cdc87c25514941c5c7f8e419e8fc88676ec","observation_id":"710b4e72-5512-47ee-a36a-bc355a4a9088","resolution":{"observed_at":"2026-08-16T10:22:31.467956Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T10:22:31.723785Z","title":"Trip: Temporal residual learning with image noise prior for image-to-video diffusion models","venue":null,"work_id":"410d6d49-9603-4ff4-8286-6e2a6ed39259","year":2024},"citing_paper":{"arxiv_id":"2504.18448","last_updated":"2025-04-25T16:01:48Z","snapshot_observed_at":"2026-08-18T02:06:37.102477Z","submitted_at":"2025-04-25T16:01:48Z","title":"NoiseController: Towards Consistent Multi-view Video Generation via Noise Decomposition and Collaboration","version":1},"reference_index":43,"source":"pdf_text","source_observed_at":"2026-08-16T10:22:31.471571Z"},"links":{"citing_paper":"/paper/2504.18448"},"observation_digest":"sha256:10bf494dc7e3b259d598dcf44449a73385b150c9771aa21b0fb853acef975a8f","observation_id":"81560830-5485-44fd-b746-936feef143a3","resolution":{"observed_at":"2026-08-16T10:22:31.727704Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2403.06845","last_updated":"2024-04-11T04:17:13Z","snapshot_observed_at":"2026-08-16T14:10:55.463304Z","submitted_at":"2024-03-11T16:03:35Z","title":"DriveDreamer-2: LLM-Enhanced World Models for Diverse Driving Video Generation","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2403.06845","snapshot_observed_at":"2026-08-16T10:22:31.475815Z","title":"Drivedreamer- 2: Llm-enhanced world models for diverse driving video gen- eration","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2504.18448","last_updated":"2025-04-25T16:01:48Z","snapshot_observed_at":"2026-08-18T02:06:37.102477Z","submitted_at":"2025-04-25T16:01:48Z","title":"NoiseController: Towards Consistent Multi-view Video Generation via Noise Decomposition and Collaboration","version":1},"reference_index":44,"source":"pdf_text","source_observed_at":"2026-08-16T10:22:31.475815Z"},"links":{"cited_paper":"/paper/2403.06845","citing_paper":"/paper/2504.18448"},"observation_digest":"sha256:9091a83fd1297a10c95b4ec8a8558a5459b5d95f20539f5e2e76ca70e8aaa283","observation_id":"6b84f5a4-4afe-4b08-9d32-8d01d0f0379a","resolution":{"observed_at":"2026-08-16T10:22:31.475815Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T10:22:31.709652Z","title":"Cross-view transform- ers for real-time map-view semantic segmentation","venue":null,"work_id":"5baf617d-75a7-4371-8cfa-ee9afa3844f7","year":2022},"citing_paper":{"arxiv_id":"2504.18448","last_updated":"2025-04-25T16:01:48Z","snapshot_observed_at":"2026-08-18T02:06:37.102477Z","submitted_at":"2025-04-25T16:01:48Z","title":"NoiseController: Towards Consistent Multi-view Video Generation via Noise Decomposition and Collaboration","version":1},"reference_index":45,"source":"pdf_text","source_observed_at":"2026-08-16T10:22:31.479585Z"},"links":{"citing_paper":"/paper/2504.18448"},"observation_digest":"sha256:7a12ae18b94a5562e9aba86cee835e60195d14bcd46c551a42def1cb12e53d29","observation_id":"75775799-ec40-43ec-8680-c3cb1a017c26","resolution":{"observed_at":"2026-08-16T10:22:31.715999Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2405.01434","last_updated":"2024-05-02T16:25:16Z","snapshot_observed_at":"2026-08-16T13:55:54.505498Z","submitted_at":"2024-05-02T16:25:16Z","title":"StoryDiffusion: Consistent Self-Attention for Long-Range Image and Video Generation","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2405.01434","snapshot_observed_at":"2026-08-16T10:22:31.483090Z","title":"Storydiffusion: Consistent self-attention for long-range image and video generation","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2504.18448","last_updated":"2025-04-25T16:01:48Z","snapshot_observed_at":"2026-08-18T02:06:37.102477Z","submitted_at":"2025-04-25T16:01:48Z","title":"NoiseController: Towards Consistent Multi-view Video Generation via Noise Decomposition and Collaboration","version":1},"reference_index":46,"source":"pdf_text","source_observed_at":"2026-08-16T10:22:31.483090Z"},"links":{"cited_paper":"/paper/2405.01434","citing_paper":"/paper/2504.18448"},"observation_digest":"sha256:a573d70b4c96fd46854155ddcff2bf36ea6f4621f860fceea1d5f15afd0d89ef","observation_id":"254af614-815a-4590-bdda-8c6610bc026b","resolution":{"observed_at":"2026-08-16T10:22:31.483090Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"paper":{"arxiv_id":"2504.18448","last_updated":"2025-04-25T16:01:48Z","latest_version":1,"primary_category":"cs.CV","snapshot_observed_at":"2026-08-18T02:06:37.102477Z","submitted_at":"2025-04-25T16:01:48Z","title":"NoiseController: Towards Consistent Multi-view Video Generation via Noise Decomposition and Collaboration"},"reference_resolution":{"displayed":46,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":23,"verified_exact":0,"verified_fuzzy":23},"total_outbound_references":46},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"thesis":"As of 18 August 2026, this Paper Citation Record lists 46 of 46 outbound references and 2 inbound Pith citation observations for arXiv:2504.18448."}