{"as_of":"2026-08-07T17:18:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:39bc8e6d2fc706006cd58d54e3b889c6d964bc0e6afa30fe2aef78abca4cdc9c","coverage":[{"denominator":0,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":33,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":33,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-07T06:34:17.273281+00:00","state":"measured"},{"denominator":33,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":33,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-07T13:28:08.459401Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":1,"source":"pith","source_observed_at":"2026-08-05T02:28:24.338817Z","state":"measured"}],"external_citation_measurements":[{"count":0,"observed_at":"2026-08-05T02:28:24.338817Z","source":"pith"}],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2407.12781","last_updated":"2025-03-22T15:40:42Z","snapshot_observed_at":"2026-08-06T09:54:26.134418Z","submitted_at":"2024-07-17T17:59:05Z","title":"VD3D: Taming Large Video Diffusion Transformers for 3D Camera Control","version":3},"cited_work":{"arxiv_id":"2407.12781","doi":"10.48550/arxiv.2407.12781","metadata_source":"pith","pith_arxiv_id":"2407.12781","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Vd3d: Taming large video diffusion transformers for 3d camera control","venue":"cs.CV","work_id":"9712b343-d948-4b8c-90a1-4bf39661f45d","year":2024},"citing_paper":{"arxiv_id":"2404.02101","last_updated":"2025-03-13T18:35:06Z","snapshot_observed_at":"2026-07-06T17:54:39.685251Z","submitted_at":"2024-04-02T16:52:41Z","title":"CameraCtrl: Enabling Camera Control for Text-to-Video Generation","version":2},"reference_index":96,"source":"arxiv_source","source_observed_at":"2026-05-13T02:06:23.410241Z"},"links":{"cited_paper":"/paper/2407.12781","citing_paper":"/paper/2404.02101"},"observation_digest":"sha256:81173c677502ca48d58014cfc351bc7fbce7f47c9c0ff525cb3754682ca4b8d8","observation_id":"d784e247-f4dd-4b5a-b754-53cfb65352d6","resolution":{"observed_at":"2026-05-13T02:06:23.563223Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2407.12781","last_updated":"2025-03-22T15:40:42Z","snapshot_observed_at":"2026-08-06T09:54:26.134418Z","submitted_at":"2024-07-17T17:59:05Z","title":"VD3D: Taming Large Video Diffusion Transformers for 3D Camera Control","version":3},"cited_work":{"arxiv_id":"2407.12781","doi":"10.48550/arxiv.2407.12781","metadata_source":"pith","pith_arxiv_id":"2407.12781","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Vd3d: Taming large video diffusion transformers for 3d camera control","venue":"cs.CV","work_id":"9712b343-d948-4b8c-90a1-4bf39661f45d","year":2024},"citing_paper":{"arxiv_id":"2409.02048","last_updated":"2024-09-03T16:53:19Z","snapshot_observed_at":"2026-07-06T19:09:55.393720Z","submitted_at":"2024-09-03T16:53:19Z","title":"ViewCrafter: Taming Video Diffusion Models for High-fidelity Novel View Synthesis","version":1},"reference_index":80,"source":"pdf_text","source_observed_at":"2026-05-13T22:59:03.642189Z"},"links":{"cited_paper":"/paper/2407.12781","citing_paper":"/paper/2409.02048"},"observation_digest":"sha256:afc7745c87d7741a329e6d2e444b39b24644fdff9d820ac6ad05a1422f9a17fb","observation_id":"fe1b001a-3e8a-44ae-8e2c-66d23bd7fe86","resolution":{"observed_at":"2026-05-13T22:59:03.794074Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2407.12781","last_updated":"2025-03-22T15:40:42Z","snapshot_observed_at":"2026-08-06T09:54:26.134418Z","submitted_at":"2024-07-17T17:59:05Z","title":"VD3D: Taming Large Video Diffusion Transformers for 3D Camera Control","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2407.12781","snapshot_observed_at":"2026-08-07T13:28:08.459401Z","title":"Bahmani, I","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.21876","last_updated":"2026-05-28T08:11:37Z","snapshot_observed_at":"2026-08-07T13:18:12.902974Z","submitted_at":"2025-05-28T01:45:26Z","title":"EPiC: Efficient Video Camera Control Learning with Precise Anchor-Video Guidance","version":2},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-07T13:28:08.459401Z"},"links":{"cited_paper":"/paper/2407.12781","citing_paper":"/paper/2505.21876"},"observation_digest":"sha256:b7ef711b6228477f827436a577336fb41d1cb015b25f72ea70777792d37ba91e","observation_id":"6610f4b4-ee52-48e5-a895-bf71d31fe11d","resolution":{"observed_at":"2026-08-07T13:28:08.459401Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2407.12781","last_updated":"2025-03-22T15:40:42Z","snapshot_observed_at":"2026-08-06T09:54:26.134418Z","submitted_at":"2024-07-17T17:59:05Z","title":"VD3D: Taming Large Video Diffusion Transformers for 3D Camera Control","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2407.12781","snapshot_observed_at":"2026-08-07T11:47:00.718882Z","title":"Vd3d: Taming large video diffusion transformers for 3d camera control.arXiv preprint arXiv:2407.12781, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.01546","last_updated":"2025-06-02T11:19:23Z","snapshot_observed_at":"2026-08-07T11:36:30.744496Z","submitted_at":"2025-06-02T11:19:23Z","title":"LongDWM: Cross-Granularity Distillation for Building a Long-Term Driving World Model","version":1},"reference_index":46,"source":"pdf_text","source_observed_at":"2026-08-07T11:47:00.718882Z"},"links":{"cited_paper":"/paper/2407.12781","citing_paper":"/paper/2506.01546"},"observation_digest":"sha256:294f19dfe8ff81c6da241fbb38e3ad8920411ba6ced7c4066aa58f3730f10f8c","observation_id":"bdbfa3f0-12a2-4962-8bd7-cb5a1b32900a","resolution":{"observed_at":"2026-08-07T11:47:00.718882Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2407.12781","last_updated":"2025-03-22T15:40:42Z","snapshot_observed_at":"2026-08-06T09:54:26.134418Z","submitted_at":"2024-07-17T17:59:05Z","title":"VD3D: Taming Large Video Diffusion Transformers for 3D Camera Control","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2407.12781","snapshot_observed_at":"2026-08-07T00:33:08.274070Z","title":"Vd3d: Taming large video diffu- sion transformers for 3d camera control.arXiv preprint arXiv:2407.12781, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.13697","last_updated":"2025-06-16T17:02:47Z","snapshot_observed_at":"2026-08-07T00:25:06.915900Z","submitted_at":"2025-06-16T17:02:47Z","title":"Vid-CamEdit: Video Camera Trajectory Editing with Generative Rendering from Estimated Geometry","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-07T00:33:08.274070Z"},"links":{"cited_paper":"/paper/2407.12781","citing_paper":"/paper/2506.13697"},"observation_digest":"sha256:0f19789962f168d1ce246a696767332ce9afb70f4073fd0d74e2925829f2735b","observation_id":"4bcb8fdb-8347-448a-a1ba-c8aecbb4dc44","resolution":{"observed_at":"2026-08-07T00:33:08.274070Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2407.12781","last_updated":"2025-03-22T15:40:42Z","snapshot_observed_at":"2026-08-06T09:54:26.134418Z","submitted_at":"2024-07-17T17:59:05Z","title":"VD3D: Taming Large Video Diffusion Transformers for 3D Camera Control","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2407.12781","snapshot_observed_at":"2026-08-06T20:26:10.495325Z","title":"Vd3d: Taming large video diffu- sion transformers for 3d camera control","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.02813","last_updated":"2025-07-03T17:21:23Z","snapshot_observed_at":"2026-08-06T22:00:54.907130Z","submitted_at":"2025-07-03T17:21:23Z","title":"LangScene-X: Reconstruct Generalizable 3D Language-Embedded Scenes with TriMap Video Diffusion","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-06T20:26:10.495325Z"},"links":{"cited_paper":"/paper/2407.12781","citing_paper":"/paper/2507.02813"},"observation_digest":"sha256:2b295e96f64a2d620a866b77026efe5a71b91ed33025911bcd2376a77604328b","observation_id":"ab5176a5-be07-4a85-a416-cb99f9d3e077","resolution":{"observed_at":"2026-08-06T20:26:10.495325Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2407.12781","last_updated":"2025-03-22T15:40:42Z","snapshot_observed_at":"2026-08-06T09:54:26.134418Z","submitted_at":"2024-07-17T17:59:05Z","title":"VD3D: Taming Large Video Diffusion Transformers for 3D Camera Control","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2407.12781","snapshot_observed_at":"2026-08-05T13:15:10.485306Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2509.00843","last_updated":"2025-08-31T13:27:15Z","snapshot_observed_at":"2026-08-07T16:59:24.631443Z","submitted_at":"2025-08-31T13:27:15Z","title":"Look Beyond: Two-Stage Scene View Generation via Panorama and Video Diffusion","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-05T13:15:10.485306Z"},"links":{"cited_paper":"/paper/2407.12781","citing_paper":"/paper/2509.00843"},"observation_digest":"sha256:0ba975eaf321e6dc971167639719398d94f5868a0aa05496fe8f0d87a0bf0062","observation_id":"387c8d9c-638f-4cac-94ab-1ef16fc03646","resolution":{"observed_at":"2026-08-05T13:15:10.485306Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2407.12781","last_updated":"2025-03-22T15:40:42Z","snapshot_observed_at":"2026-08-06T09:54:26.134418Z","submitted_at":"2024-07-17T17:59:05Z","title":"VD3D: Taming Large Video Diffusion Transformers for 3D Camera Control","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2407.12781","snapshot_observed_at":"2026-08-04T08:57:05.028270Z","title":"Vd3d: Taming large video diffu- sion transformers for 3d camera control.arXiv preprint arXiv:2407.12781, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2510.18313","last_updated":"2026-06-29T02:20:45Z","snapshot_observed_at":"2026-08-06T20:20:34.094359Z","submitted_at":"2025-10-21T05:49:01Z","title":"OmniNWM: Omniscient Driving Navigation World Models","version":6},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-04T08:57:05.028270Z"},"links":{"cited_paper":"/paper/2407.12781","citing_paper":"/paper/2510.18313"},"observation_digest":"sha256:5f82c7363750c90a1a924eac63962e52808232b4fa998db08007f1b0415a726f","observation_id":"2831a9cf-f7e3-447a-aaaf-af1504a6e8cf","resolution":{"observed_at":"2026-08-04T08:57:05.028270Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2407.12781","last_updated":"2025-03-22T15:40:42Z","snapshot_observed_at":"2026-08-06T09:54:26.134418Z","submitted_at":"2024-07-17T17:59:05Z","title":"VD3D: Taming Large Video Diffusion Transformers for 3D Camera Control","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2407.12781","snapshot_observed_at":"2026-08-03T21:01:06.386578Z","title":"Vd3d: Taming large video diffu- sion transformers for 3d camera control.arXiv preprint arXiv:2407.12781, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2511.17185","last_updated":"2026-05-29T08:17:11Z","snapshot_observed_at":"2026-08-03T21:01:05.108421Z","submitted_at":"2025-11-21T12:05:46Z","title":"PostCam: Camera-Controllable Novel-View Video Generation with Query-Shared Cross-Attention","version":2},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-03T21:01:06.386578Z"},"links":{"cited_paper":"/paper/2407.12781","citing_paper":"/paper/2511.17185"},"observation_digest":"sha256:d00d6e2f282ed127944269757e3410d2751df7177397499d4c5b65f8967f8d1a","observation_id":"0d49eacd-0a98-44e6-b278-b848fcf9b09a","resolution":{"observed_at":"2026-08-03T21:01:06.386578Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2407.12781","last_updated":"2025-03-22T15:40:42Z","snapshot_observed_at":"2026-08-06T09:54:26.134418Z","submitted_at":"2024-07-17T17:59:05Z","title":"VD3D: Taming Large Video Diffusion Transformers for 3D Camera Control","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2407.12781","snapshot_observed_at":"2026-08-03T18:26:31.548588Z","title":"Vd3d: Taming large video diffusion transformers for 3d camera control.arXiv preprint arXiv:2407.12781, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2512.05672","last_updated":"2026-07-06T07:23:46Z","snapshot_observed_at":"2026-08-04T17:03:44.669117Z","submitted_at":"2025-12-05T12:31:09Z","title":"InverseCrafter: Efficient Video ReCapture as a Latent Domain Inverse Problem","version":2},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-03T18:26:31.548588Z"},"links":{"cited_paper":"/paper/2407.12781","citing_paper":"/paper/2512.05672"},"observation_digest":"sha256:2ddc9022966271421594a644857dcae4a73bd1745d74f24780836326b2008cc1","observation_id":"fe6a78ec-284d-4bfb-ab4c-ea7e31c0f2dd","resolution":{"observed_at":"2026-08-03T18:26:31.548588Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2407.12781","last_updated":"2025-03-22T15:40:42Z","snapshot_observed_at":"2026-08-06T09:54:26.134418Z","submitted_at":"2024-07-17T17:59:05Z","title":"VD3D: Taming Large Video Diffusion Transformers for 3D Camera Control","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2407.12781","snapshot_observed_at":"2026-08-03T05:25:02.032281Z","title":"J., Tulyakov, S., Wetzstein, G., et al","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2602.02402","last_updated":"2026-07-18T03:12:13Z","snapshot_observed_at":"2026-08-07T03:07:40.563869Z","submitted_at":"2026-02-02T17:59:31Z","title":"SoMA: A Real-to-Sim Neural Simulator for Robotic Soft-body Manipulation","version":2},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-03T05:25:02.032281Z"},"links":{"cited_paper":"/paper/2407.12781","citing_paper":"/paper/2602.02402"},"observation_digest":"sha256:8c04895531dace51a0176448b9373a095f380967a0c74a2a65247945d9a63387","observation_id":"310cad1e-00f5-44b4-a44d-82423753cecd","resolution":{"observed_at":"2026-08-03T05:25:02.032281Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2407.12781","last_updated":"2025-03-22T15:40:42Z","snapshot_observed_at":"2026-08-06T09:54:26.134418Z","submitted_at":"2024-07-17T17:59:05Z","title":"VD3D: Taming Large Video Diffusion Transformers for 3D Camera Control","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2407.12781","snapshot_observed_at":"2026-07-13T12:26:54.361488Z","title":"Vd3d: Taming large video diffu- sion transformers for 3d camera control.arXiv preprint arXiv:2407.12781, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2604.03723","last_updated":"2026-06-24T08:25:16Z","snapshot_observed_at":"2026-08-06T04:57:30.700520Z","submitted_at":"2026-04-04T12:59:24Z","title":"SymphoMotion: Joint Control of Camera Motion and Object Dynamics for Coherent Video Generation","version":4},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-07-13T12:26:54.361488Z"},"links":{"cited_paper":"/paper/2407.12781","citing_paper":"/paper/2604.03723"},"observation_digest":"sha256:9846f920cb5e0e3066729ab21c494b074498c7af41b005cdaefcb617d50c9ffb","observation_id":"5b3c1544-2bf3-4d15-b1bf-f8100b949e6c","resolution":{"observed_at":"2026-07-13T12:26:54.361488Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2407.12781","last_updated":"2025-03-22T15:40:42Z","snapshot_observed_at":"2026-08-06T09:54:26.134418Z","submitted_at":"2024-07-17T17:59:05Z","title":"VD3D: Taming Large Video Diffusion Transformers for 3D Camera Control","version":3},"cited_work":{"arxiv_id":"2407.12781","doi":"10.48550/arxiv.2407.12781","metadata_source":"pith","pith_arxiv_id":"2407.12781","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Vd3d: Taming large video diffusion transformers for 3d camera control","venue":"cs.CV","work_id":"9712b343-d948-4b8c-90a1-4bf39661f45d","year":2024},"citing_paper":{"arxiv_id":"2604.07209","last_updated":"2026-04-13T13:03:18Z","snapshot_observed_at":"2026-07-06T22:55:28.855291Z","submitted_at":"2026-04-08T15:31:22Z","title":"INSPATIO-WORLD: A Real-Time 4D World Simulator via Spatiotemporal Autoregressive Modeling","version":2},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-05-10T19:08:56.588282Z"},"links":{"cited_paper":"/paper/2407.12781","citing_paper":"/paper/2604.07209"},"observation_digest":"sha256:7dbf49111cdc34bca69aac4b750c7909c9880fd0b02d74d6c2acedabaad2e9f7","observation_id":"c2137e25-af87-470c-8e47-d211465274b8","resolution":{"observed_at":"2026-05-10T23:25:53.614176Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2407.12781","last_updated":"2025-03-22T15:40:42Z","snapshot_observed_at":"2026-08-06T09:54:26.134418Z","submitted_at":"2024-07-17T17:59:05Z","title":"VD3D: Taming Large Video Diffusion Transformers for 3D Camera Control","version":3},"cited_work":{"arxiv_id":"2407.12781","doi":"10.48550/arxiv.2407.12781","metadata_source":"pith","pith_arxiv_id":"2407.12781","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Vd3d: Taming large video diffusion transformers for 3d camera control","venue":"cs.CV","work_id":"9712b343-d948-4b8c-90a1-4bf39661f45d","year":2024},"citing_paper":{"arxiv_id":"2604.17565","last_updated":"2026-06-26T02:04:58Z","snapshot_observed_at":"2026-07-06T23:04:37.370465Z","submitted_at":"2026-04-19T18:11:08Z","title":"UniGeo: Unifying Geometric Guidance for Camera-Controllable Image Editing via Video Models","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-05-10T06:03:06.920592Z"},"links":{"cited_paper":"/paper/2407.12781","citing_paper":"/paper/2604.17565"},"observation_digest":"sha256:0c9b0e7b56f48fcf4ba93f8fe03974d2e6d55b33596b3d0a697b1eb23b41006b","observation_id":"d3f3272e-ee30-40e7-82be-c6d3d4077b47","resolution":{"observed_at":"2026-05-10T06:06:18.982509Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2407.12781","last_updated":"2025-03-22T15:40:42Z","snapshot_observed_at":"2026-08-06T09:54:26.134418Z","submitted_at":"2024-07-17T17:59:05Z","title":"VD3D: Taming Large Video Diffusion Transformers for 3D Camera Control","version":3},"cited_work":{"arxiv_id":"2407.12781","doi":"10.48550/arxiv.2407.12781","metadata_source":"pith","pith_arxiv_id":"2407.12781","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Vd3d: Taming large video diffusion transformers for 3d camera control","venue":"cs.CV","work_id":"9712b343-d948-4b8c-90a1-4bf39661f45d","year":2024},"citing_paper":{"arxiv_id":"2604.17565","last_updated":"2026-06-26T02:04:58Z","snapshot_observed_at":"2026-07-06T23:04:37.370465Z","submitted_at":"2026-04-19T18:11:08Z","title":"UniGeo: Unifying Geometric Guidance for Camera-Controllable Image Editing via Video Models","version":2},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-05-12T02:52:58.232585Z"},"links":{"cited_paper":"/paper/2407.12781","citing_paper":"/paper/2604.17565"},"observation_digest":"sha256:5eb47d69c62b3e9c248ceccebacb225b2434b898707f127c971a04b7067f951d","observation_id":"5cabc11e-313b-4eec-8baf-3bcc50ca55cd","resolution":{"observed_at":"2026-05-12T07:26:29.968851Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2407.12781","last_updated":"2025-03-22T15:40:42Z","snapshot_observed_at":"2026-08-06T09:54:26.134418Z","submitted_at":"2024-07-17T17:59:05Z","title":"VD3D: Taming Large Video Diffusion Transformers for 3D Camera Control","version":3},"cited_work":{"arxiv_id":"2407.12781","doi":"10.48550/arxiv.2407.12781","metadata_source":"pith","pith_arxiv_id":"2407.12781","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Vd3d: Taming large video diffusion transformers for 3d camera control","venue":"cs.CV","work_id":"9712b343-d948-4b8c-90a1-4bf39661f45d","year":2024},"citing_paper":{"arxiv_id":"2604.17565","last_updated":"2026-06-26T02:04:58Z","snapshot_observed_at":"2026-07-06T23:04:37.370465Z","submitted_at":"2026-04-19T18:11:08Z","title":"UniGeo: Unifying Geometric Guidance for Camera-Controllable Image Editing via Video Models","version":4},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-07-05T16:47:32.853010Z"},"links":{"cited_paper":"/paper/2407.12781","citing_paper":"/paper/2604.17565"},"observation_digest":"sha256:c6d7f3dc267ab5de12085453e70937b53e845d5932836f1a6bed4a1da045fc50","observation_id":"c083f495-6ba4-47b5-a76f-7fc1a7120b30","resolution":{"observed_at":"2026-07-05T16:51:14.262185Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2407.12781","last_updated":"2025-03-22T15:40:42Z","snapshot_observed_at":"2026-08-06T09:54:26.134418Z","submitted_at":"2024-07-17T17:59:05Z","title":"VD3D: Taming Large Video Diffusion Transformers for 3D Camera Control","version":3},"cited_work":{"arxiv_id":"2407.12781","doi":"10.48550/arxiv.2407.12781","metadata_source":"pith","pith_arxiv_id":"2407.12781","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Vd3d: Taming large video diffusion transformers for 3d camera control","venue":"cs.CV","work_id":"9712b343-d948-4b8c-90a1-4bf39661f45d","year":2024},"citing_paper":{"arxiv_id":"2605.11871","last_updated":"2026-05-16T12:55:04Z","snapshot_observed_at":"2026-08-01T03:28:43.130953Z","submitted_at":"2026-05-12T09:51:04Z","title":"$h$-control: Training-Free Camera Control via Block-Conditional Gibbs Refinement","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-05-13T07:09:32.103652Z"},"links":{"cited_paper":"/paper/2407.12781","citing_paper":"/paper/2605.11871"},"observation_digest":"sha256:44489947686de9ed7270e53b744122af47473f2a28021971b7c9ca37ce0fa66b","observation_id":"a39d6f41-a31e-4a99-b34a-ee7c045becc8","resolution":{"observed_at":"2026-05-13T07:12:28.138002Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2407.12781","last_updated":"2025-03-22T15:40:42Z","snapshot_observed_at":"2026-08-06T09:54:26.134418Z","submitted_at":"2024-07-17T17:59:05Z","title":"VD3D: Taming Large Video Diffusion Transformers for 3D Camera Control","version":3},"cited_work":{"arxiv_id":"2407.12781","doi":"10.48550/arxiv.2407.12781","metadata_source":"pith","pith_arxiv_id":"2407.12781","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Vd3d: Taming large video diffusion transformers for 3d camera control","venue":"cs.CV","work_id":"9712b343-d948-4b8c-90a1-4bf39661f45d","year":2024},"citing_paper":{"arxiv_id":"2605.11871","last_updated":"2026-05-16T12:55:04Z","snapshot_observed_at":"2026-08-01T03:28:43.130953Z","submitted_at":"2026-05-12T09:51:04Z","title":"$h$-control: Training-Free Camera Control via Block-Conditional Gibbs Refinement","version":2},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-05-20T22:55:00.590833Z"},"links":{"cited_paper":"/paper/2407.12781","citing_paper":"/paper/2605.11871"},"observation_digest":"sha256:d4b37603ec3e5509571e0a0baa73567b213fba1babb0c98870c2c0e3b4f8f03f","observation_id":"cc3a6092-85a6-472e-a531-18bb03b60294","resolution":{"observed_at":"2026-05-20T22:59:11.892862Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2407.12781","last_updated":"2025-03-22T15:40:42Z","snapshot_observed_at":"2026-08-06T09:54:26.134418Z","submitted_at":"2024-07-17T17:59:05Z","title":"VD3D: Taming Large Video Diffusion Transformers for 3D Camera Control","version":3},"cited_work":{"arxiv_id":"2407.12781","doi":"10.48550/arxiv.2407.12781","metadata_source":"pith","pith_arxiv_id":"2407.12781","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Vd3d: Taming large video diffusion transformers for 3d camera control","venue":"cs.CV","work_id":"9712b343-d948-4b8c-90a1-4bf39661f45d","year":2024},"citing_paper":{"arxiv_id":"2605.12119","last_updated":"2026-05-13T01:49:16Z","snapshot_observed_at":"2026-08-02T15:32:07.680099Z","submitted_at":"2026-05-12T13:35:54Z","title":"MoCam: Unified Novel View Synthesis via Structured Denoising Dynamics","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-05-13T05:42:31.717412Z"},"links":{"cited_paper":"/paper/2407.12781","citing_paper":"/paper/2605.12119"},"observation_digest":"sha256:70dd32b1f7fe924e28f6b176039f38e16f8a8647f811030e82a2d795ca842741","observation_id":"984f7f0c-2b65-4816-b3b3-d6192d0762d7","resolution":{"observed_at":"2026-05-13T05:47:21.481126Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2407.12781","last_updated":"2025-03-22T15:40:42Z","snapshot_observed_at":"2026-08-06T09:54:26.134418Z","submitted_at":"2024-07-17T17:59:05Z","title":"VD3D: Taming Large Video Diffusion Transformers for 3D Camera Control","version":3},"cited_work":{"arxiv_id":"2407.12781","doi":"10.48550/arxiv.2407.12781","metadata_source":"pith","pith_arxiv_id":"2407.12781","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Vd3d: Taming large video diffusion transformers for 3d camera control","venue":"cs.CV","work_id":"9712b343-d948-4b8c-90a1-4bf39661f45d","year":2024},"citing_paper":{"arxiv_id":"2605.12119","last_updated":"2026-05-13T01:49:16Z","snapshot_observed_at":"2026-08-02T15:32:07.680099Z","submitted_at":"2026-05-12T13:35:54Z","title":"MoCam: Unified Novel View Synthesis via Structured Denoising Dynamics","version":2},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-05-14T21:56:38.133405Z"},"links":{"cited_paper":"/paper/2407.12781","citing_paper":"/paper/2605.12119"},"observation_digest":"sha256:90a28dc736285ab75ae8fb652fe332fc0a244309860129365ed01c99d8c71b5c","observation_id":"df99b25d-d054-47d7-8b70-1a43f8a7af6e","resolution":{"observed_at":"2026-05-14T21:58:03.151805Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2407.12781","last_updated":"2025-03-22T15:40:42Z","snapshot_observed_at":"2026-08-06T09:54:26.134418Z","submitted_at":"2024-07-17T17:59:05Z","title":"VD3D: Taming Large Video Diffusion Transformers for 3D Camera Control","version":3},"cited_work":{"arxiv_id":"2407.12781","doi":"10.48550/arxiv.2407.12781","metadata_source":"pith","pith_arxiv_id":"2407.12781","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Vd3d: Taming large video diffusion transformers for 3d camera control","venue":"cs.CV","work_id":"9712b343-d948-4b8c-90a1-4bf39661f45d","year":2024},"citing_paper":{"arxiv_id":"2605.13838","last_updated":"2026-06-27T12:19:23Z","snapshot_observed_at":"2026-08-01T20:39:26.680238Z","submitted_at":"2026-05-13T17:58:13Z","title":"R-DMesh: Video-Guided 3D Animation via Rectified Dynamic Mesh Flow","version":1},"reference_index":122,"source":"arxiv_source","source_observed_at":"2026-05-14T19:07:53.671769Z"},"links":{"cited_paper":"/paper/2407.12781","citing_paper":"/paper/2605.13838"},"observation_digest":"sha256:c7a9a6fd194af40099884a0569c74558515e782e84ad9df781cc1c89bae57dd7","observation_id":"2d2f7064-89f8-4175-829b-ae11f16c872b","resolution":{"observed_at":"2026-05-14T19:09:23.661409Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2407.12781","last_updated":"2025-03-22T15:40:42Z","snapshot_observed_at":"2026-08-06T09:54:26.134418Z","submitted_at":"2024-07-17T17:59:05Z","title":"VD3D: Taming Large Video Diffusion Transformers for 3D Camera Control","version":3},"cited_work":{"arxiv_id":"2407.12781","doi":"10.48550/arxiv.2407.12781","metadata_source":"pith","pith_arxiv_id":"2407.12781","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Vd3d: Taming large video diffusion transformers for 3d camera control","venue":"cs.CV","work_id":"9712b343-d948-4b8c-90a1-4bf39661f45d","year":2024},"citing_paper":{"arxiv_id":"2605.13838","last_updated":"2026-06-27T12:19:23Z","snapshot_observed_at":"2026-08-01T20:39:26.680238Z","submitted_at":"2026-05-13T17:58:13Z","title":"R-DMesh: Video-Guided 3D Animation via Rectified Dynamic Mesh Flow","version":2},"reference_index":122,"source":"arxiv_source","source_observed_at":"2026-05-15T06:08:52.321351Z"},"links":{"cited_paper":"/paper/2407.12781","citing_paper":"/paper/2605.13838"},"observation_digest":"sha256:a802aaa9c25d4d6f4c8f7bc46a9f72e910a93f2971392d03b51280ed22fb93b4","observation_id":"c7a1dbb5-e0be-4d11-b120-c1d97778221f","resolution":{"observed_at":"2026-05-15T06:09:49.443434Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2407.12781","last_updated":"2025-03-22T15:40:42Z","snapshot_observed_at":"2026-08-06T09:54:26.134418Z","submitted_at":"2024-07-17T17:59:05Z","title":"VD3D: Taming Large Video Diffusion Transformers for 3D Camera Control","version":3},"cited_work":{"arxiv_id":"2407.12781","doi":"10.48550/arxiv.2407.12781","metadata_source":"pith","pith_arxiv_id":"2407.12781","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Vd3d: Taming large video diffusion transformers for 3d camera control","venue":"cs.CV","work_id":"9712b343-d948-4b8c-90a1-4bf39661f45d","year":2024},"citing_paper":{"arxiv_id":"2605.14815","last_updated":"2026-05-14T13:27:33Z","snapshot_observed_at":"2026-08-02T19:23:49.520789Z","submitted_at":"2026-05-14T13:27:33Z","title":"Probing into Camera Control of Video Models","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-06-30T21:11:19.441408Z"},"links":{"cited_paper":"/paper/2407.12781","citing_paper":"/paper/2605.14815"},"observation_digest":"sha256:3e71540b2520153a7924b9459e8307af313602e9fbf5b2bcf14958df702f51f3","observation_id":"c57bb19d-31ec-4429-a95f-473813a2d17e","resolution":{"observed_at":"2026-06-30T21:15:04.343521Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2407.12781","last_updated":"2025-03-22T15:40:42Z","snapshot_observed_at":"2026-08-06T09:54:26.134418Z","submitted_at":"2024-07-17T17:59:05Z","title":"VD3D: Taming Large Video Diffusion Transformers for 3D Camera Control","version":3},"cited_work":{"arxiv_id":"2407.12781","doi":"10.48550/arxiv.2407.12781","metadata_source":"pith","pith_arxiv_id":"2407.12781","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Vd3d: Taming large video diffusion transformers for 3d camera control","venue":"cs.CV","work_id":"9712b343-d948-4b8c-90a1-4bf39661f45d","year":2024},"citing_paper":{"arxiv_id":"2605.18365","last_updated":"2026-05-18T13:17:08Z","snapshot_observed_at":"2026-08-02T07:31:08.555715Z","submitted_at":"2026-05-18T13:17:08Z","title":"GeoFlow: Enforcing Implicit Geometric Consistency in Video Generation","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-05-20T11:06:09.367559Z"},"links":{"cited_paper":"/paper/2407.12781","citing_paper":"/paper/2605.18365"},"observation_digest":"sha256:6a0b286532faf1fb3ee4cc0aef3517b72a0fcdd74178c7f90cc0d9be66d7bc72","observation_id":"aa4579c2-f921-4279-bcaa-691cb4a14483","resolution":{"observed_at":"2026-05-20T11:08:13.672536Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2407.12781","last_updated":"2025-03-22T15:40:42Z","snapshot_observed_at":"2026-08-06T09:54:26.134418Z","submitted_at":"2024-07-17T17:59:05Z","title":"VD3D: Taming Large Video Diffusion Transformers for 3D Camera Control","version":3},"cited_work":{"arxiv_id":"2407.12781","doi":"10.48550/arxiv.2407.12781","metadata_source":"pith","pith_arxiv_id":"2407.12781","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Vd3d: Taming large video diffusion transformers for 3d camera control","venue":"cs.CV","work_id":"9712b343-d948-4b8c-90a1-4bf39661f45d","year":2024},"citing_paper":{"arxiv_id":"2606.07508","last_updated":"2026-06-05T17:57:32Z","snapshot_observed_at":"2026-08-03T10:42:24.485829Z","submitted_at":"2026-06-05T17:57:32Z","title":"Streaming Video Generation with Streaming Force Control","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-06-27T22:14:32.465663Z"},"links":{"cited_paper":"/paper/2407.12781","citing_paper":"/paper/2606.07508"},"observation_digest":"sha256:f5590d9951046b0f04b998bb482191f122dcac89e814a804fda6bbf479a85812","observation_id":"8fb0288b-5c09-4199-b4f0-bc5b5afae3da","resolution":{"observed_at":"2026-07-02T17:07:12.412595Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2407.12781","last_updated":"2025-03-22T15:40:42Z","snapshot_observed_at":"2026-08-06T09:54:26.134418Z","submitted_at":"2024-07-17T17:59:05Z","title":"VD3D: Taming Large Video Diffusion Transformers for 3D Camera Control","version":3},"cited_work":{"arxiv_id":"2407.12781","doi":"10.48550/arxiv.2407.12781","metadata_source":"pith","pith_arxiv_id":"2407.12781","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Vd3d: Taming large video diffusion transformers for 3d camera control","venue":"cs.CV","work_id":"9712b343-d948-4b8c-90a1-4bf39661f45d","year":2024},"citing_paper":{"arxiv_id":"2606.20774","last_updated":"2026-06-18T16:07:05Z","snapshot_observed_at":"2026-08-02T15:04:03.513314Z","submitted_at":"2026-06-18T16:07:05Z","title":"TriMotion: Modality-Agnostic Camera Control for Video Generation","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-06-26T18:11:49.696524Z"},"links":{"cited_paper":"/paper/2407.12781","citing_paper":"/paper/2606.20774"},"observation_digest":"sha256:44eb623a000755c93344303d838eeff4caef934a8d2faa2f44d8fed421d47ade","observation_id":"1961b9c6-0fa8-4278-b54c-a8814acce7c3","resolution":{"observed_at":"2026-07-04T03:19:31.326582Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2407.12781","last_updated":"2025-03-22T15:40:42Z","snapshot_observed_at":"2026-08-06T09:54:26.134418Z","submitted_at":"2024-07-17T17:59:05Z","title":"VD3D: Taming Large Video Diffusion Transformers for 3D Camera Control","version":3},"cited_work":{"arxiv_id":"2407.12781","doi":"10.48550/arxiv.2407.12781","metadata_source":"pith","pith_arxiv_id":"2407.12781","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Vd3d: Taming large video diffusion transformers for 3d camera control","venue":"cs.CV","work_id":"9712b343-d948-4b8c-90a1-4bf39661f45d","year":2024},"citing_paper":{"arxiv_id":"2606.22481","last_updated":"2026-06-21T12:50:07Z","snapshot_observed_at":"2026-07-06T23:57:18.596834Z","submitted_at":"2026-06-21T12:50:07Z","title":"Lighting-Consistent Object Transfer Across Radiance Fields","version":1},"reference_index":225,"source":"arxiv_source","source_observed_at":"2026-06-26T09:46:46.216810Z"},"links":{"cited_paper":"/paper/2407.12781","citing_paper":"/paper/2606.22481"},"observation_digest":"sha256:b7aa3d2ed8a5e56e330b2be547a68fc6292789d6847f7195a2bec76a40329762","observation_id":"b5ea3002-512c-4046-a7f6-675b1a4d4d6c","resolution":{"observed_at":"2026-06-26T09:49:18.033981Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2407.12781","last_updated":"2025-03-22T15:40:42Z","snapshot_observed_at":"2026-08-06T09:54:26.134418Z","submitted_at":"2024-07-17T17:59:05Z","title":"VD3D: Taming Large Video Diffusion Transformers for 3D Camera Control","version":3},"cited_work":{"arxiv_id":"2407.12781","doi":"10.48550/arxiv.2407.12781","metadata_source":"pith","pith_arxiv_id":"2407.12781","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Vd3d: Taming large video diffusion transformers for 3d camera control","venue":"cs.CV","work_id":"9712b343-d948-4b8c-90a1-4bf39661f45d","year":2024},"citing_paper":{"arxiv_id":"2606.26964","last_updated":"2026-06-26T09:10:44Z","snapshot_observed_at":"2026-08-05T10:39:41.227539Z","submitted_at":"2026-06-25T12:38:39Z","title":"Look-Before-Move: Narrative-Grounded World Visual Attention in Dynamic 3D Story Worlds","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-06-26T04:51:38.355857Z"},"links":{"cited_paper":"/paper/2407.12781","citing_paper":"/paper/2606.26964"},"observation_digest":"sha256:0c33511695a4315455e9fd7c0cd647ac133dec929b82040a491e81dcc337b0d7","observation_id":"039ac74f-04ec-4133-a7e2-eb822b9aa593","resolution":{"observed_at":"2026-07-04T13:49:52.330305Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2407.12781","last_updated":"2025-03-22T15:40:42Z","snapshot_observed_at":"2026-08-06T09:54:26.134418Z","submitted_at":"2024-07-17T17:59:05Z","title":"VD3D: Taming Large Video Diffusion Transformers for 3D Camera Control","version":3},"cited_work":{"arxiv_id":"2407.12781","doi":"10.48550/arxiv.2407.12781","metadata_source":"pith","pith_arxiv_id":"2407.12781","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Vd3d: Taming large video diffusion transformers for 3d camera control","venue":"cs.CV","work_id":"9712b343-d948-4b8c-90a1-4bf39661f45d","year":2024},"citing_paper":{"arxiv_id":"2606.26964","last_updated":"2026-06-26T09:10:44Z","snapshot_observed_at":"2026-08-05T10:39:41.227539Z","submitted_at":"2026-06-25T12:38:39Z","title":"Look-Before-Move: Narrative-Grounded World Visual Attention in Dynamic 3D Story Worlds","version":2},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-06-29T04:55:32.982338Z"},"links":{"cited_paper":"/paper/2407.12781","citing_paper":"/paper/2606.26964"},"observation_digest":"sha256:1770fd22510b52c84ac347cdb67ef9505eba2481ffe00c78b9680a70bdec962f","observation_id":"2714b02e-9a3d-41c6-857c-c9db5566a43c","resolution":{"observed_at":"2026-06-29T19:13:52.824178Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2407.12781","last_updated":"2025-03-22T15:40:42Z","snapshot_observed_at":"2026-08-06T09:54:26.134418Z","submitted_at":"2024-07-17T17:59:05Z","title":"VD3D: Taming Large Video Diffusion Transformers for 3D Camera Control","version":3},"cited_work":{"arxiv_id":"2407.12781","doi":"10.48550/arxiv.2407.12781","metadata_source":"pith","pith_arxiv_id":"2407.12781","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Vd3d: Taming large video diffusion transformers for 3d camera control","venue":"cs.CV","work_id":"9712b343-d948-4b8c-90a1-4bf39661f45d","year":2024},"citing_paper":{"arxiv_id":"2606.29020","last_updated":"2026-06-27T17:38:21Z","snapshot_observed_at":"2026-07-07T00:03:02.476882Z","submitted_at":"2026-06-27T17:38:21Z","title":"Semantic-Aware, Physics-Informed, Geometry-Grounded Weather Video Synthesis","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-06-30T09:19:50.748415Z"},"links":{"cited_paper":"/paper/2407.12781","citing_paper":"/paper/2606.29020"},"observation_digest":"sha256:164e6fda7bc8af75ac839f8eee1668c21b15d8c5609f4ef1cc32ce6d0a1f9024","observation_id":"0f1bc6d9-2c78-40be-9861-05ad3631740c","resolution":{"observed_at":"2026-06-30T09:24:32.492574Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2407.12781","last_updated":"2025-03-22T15:40:42Z","snapshot_observed_at":"2026-08-06T09:54:26.134418Z","submitted_at":"2024-07-17T17:59:05Z","title":"VD3D: Taming Large Video Diffusion Transformers for 3D Camera Control","version":3},"cited_work":{"arxiv_id":"2407.12781","doi":"10.48550/arxiv.2407.12781","metadata_source":"pith","pith_arxiv_id":"2407.12781","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Vd3d: Taming large video diffusion transformers for 3d camera control","venue":"cs.CV","work_id":"9712b343-d948-4b8c-90a1-4bf39661f45d","year":2024},"citing_paper":{"arxiv_id":"2607.06216","last_updated":"2026-08-03T15:49:45Z","snapshot_observed_at":"2026-08-06T23:37:49.737678Z","submitted_at":"2026-07-07T12:41:19Z","title":"MoWorld: A Flash World Model","version":1},"reference_index":51,"source":"pdf_text","source_observed_at":"2026-07-08T13:10:31.940263Z"},"links":{"cited_paper":"/paper/2407.12781","citing_paper":"/paper/2607.06216"},"observation_digest":"sha256:e0e241b353507db1a240c830478933a9ebd7807473b34e04302192c2e3c9e93c","observation_id":"2c83d53e-46c3-4833-ba33-59cc63473350","resolution":{"observed_at":"2026-07-08T13:14:53.268098Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2407.12781","last_updated":"2025-03-22T15:40:42Z","snapshot_observed_at":"2026-08-06T09:54:26.134418Z","submitted_at":"2024-07-17T17:59:05Z","title":"VD3D: Taming Large Video Diffusion Transformers for 3D Camera Control","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2407.12781","snapshot_observed_at":"2026-08-04T04:32:04.136455Z","title":"Vd3d: Taming large video diffusion transformers for 3d camera control.arXiv preprint arXiv:2407.12781, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.06216","last_updated":"2026-08-03T15:49:45Z","snapshot_observed_at":"2026-08-06T23:37:49.737678Z","submitted_at":"2026-07-07T12:41:19Z","title":"MoWorld: A Flash World Model","version":2},"reference_index":51,"source":"pdf_text","source_observed_at":"2026-08-04T04:32:04.136455Z"},"links":{"cited_paper":"/paper/2407.12781","citing_paper":"/paper/2607.06216"},"observation_digest":"sha256:740547a83703bf1f6bdbddaf1e009d29f495b7c1baca7d76f6b541f354723bc0","observation_id":"0488fad1-ff9b-4690-883c-dbf0cd69ffd3","resolution":{"observed_at":"2026-08-04T04:32:04.136455Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2407.12781","last_updated":"2025-03-22T15:40:42Z","snapshot_observed_at":"2026-08-06T09:54:26.134418Z","submitted_at":"2024-07-17T17:59:05Z","title":"VD3D: Taming Large Video Diffusion Transformers for 3D Camera Control","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2407.12781","snapshot_observed_at":"2026-07-14T03:51:24.547781Z","title":"arXiv preprint arXiv:2407.12781 , year=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.11689","last_updated":"2026-07-13T15:22:56Z","snapshot_observed_at":"2026-08-02T18:20:32.168835Z","submitted_at":"2026-07-13T15:22:56Z","title":"From World Action Models to Embodied Brains: A Roadmap for Open-World Physical Intelligence","version":1},"reference_index":12,"source":"arxiv_source","source_observed_at":"2026-07-14T03:51:24.547781Z"},"links":{"cited_paper":"/paper/2407.12781","citing_paper":"/paper/2607.11689"},"observation_digest":"sha256:e24a4327d75ada78c8bcd49feddb4169c6e56b8c991dde7163dab8894fff0b2c","observation_id":"328798d7-c366-47cc-a66e-fa6b50903b11","resolution":{"observed_at":"2026-07-14T03:51:24.547781Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"links":{"evidence":"/evidence","html":"/paper/2407.12781/citation-record","integrity":"/paper/2407.12781/integrity","json":"/paper/2407.12781/citation-record.json","paper":"/paper/2407.12781"},"outbound":[],"paper":{"arxiv_id":"2407.12781","last_updated":"2025-03-22T15:40:42Z","latest_version":3,"primary_category":"cs.CV","snapshot_observed_at":"2026-08-06T09:54:26.134418Z","submitted_at":"2024-07-17T17:59:05Z","title":"VD3D: Taming Large Video Diffusion Transformers for 3D Camera Control"},"reference_resolution":{"displayed":0,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":0,"verified_exact":0,"verified_fuzzy":0},"total_outbound_references":0},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"thesis":"As of 7 August 2026, this Paper Citation Record lists 0 of 0 outbound references and 33 inbound Pith citation observations for arXiv:2407.12781."}