{"as_of":"2026-08-22T04:00:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:8a57c75396d7c73fa4e996762e3d10690270d0f2ca7641ac30c1e7534a358ef4","coverage":[{"denominator":44,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":44,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-03T21:01:10.584591Z","state":"measured"},{"denominator":47,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":47,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-21T06:32:19.484+00:00","state":"measured"},{"denominator":3,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":3,"source":"paper_references, paper_reference_links","source_observed_at":"2026-07-31T11:10:41.415757Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"pith","source_observed_at":"2026-07-04T20:50:11.187124Z","state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2511.17185","last_updated":"2026-05-29T08:17:11Z","snapshot_observed_at":"2026-08-03T21:01:05.108421Z","submitted_at":"2025-11-21T12:05:46Z","title":"PostCam: Camera-Controllable Novel-View Video Generation with Query-Shared Cross-Attention","version":2},"cited_work":{"arxiv_id":"2511.17185","doi":null,"metadata_source":"pith","pith_arxiv_id":"2511.17185","snapshot_observed_at":"2026-07-04T20:50:11.187124Z","title":"PostCam: Camera-Controllable Novel-View Video Generation with Query- Shared Cross-Attention","venue":"cs.CV","work_id":"973efba6-3687-421f-aa3e-0986acf3283b","year":2025},"citing_paper":{"arxiv_id":"2604.07209","last_updated":"2026-04-13T13:03:18Z","snapshot_observed_at":"2026-08-18T15:38:48.854766Z","submitted_at":"2026-04-08T15:31:22Z","title":"INSPATIO-WORLD: A Real-Time 4D World Simulator via Spatiotemporal Autoregressive Modeling","version":2},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-05-10T19:08:56.588282Z"},"links":{"cited_paper":"/paper/2511.17185","citing_paper":"/paper/2604.07209"},"observation_digest":"sha256:675b7ef5153223f0ca0b77acde581acb236bac915b0f5bfb7b91885f65a56eff","observation_id":"ce782ef3-8c84-47ca-a8ba-23fa1275fb8d","resolution":{"observed_at":"2026-06-01T02:02:22.028800Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2511.17185","last_updated":"2026-05-29T08:17:11Z","snapshot_observed_at":"2026-08-03T21:01:05.108421Z","submitted_at":"2025-11-21T12:05:46Z","title":"PostCam: Camera-Controllable Novel-View Video Generation with Query-Shared Cross-Attention","version":2},"cited_work":{"arxiv_id":"2511.17185","doi":null,"metadata_source":"pith","pith_arxiv_id":"2511.17185","snapshot_observed_at":"2026-07-04T20:50:11.187124Z","title":"PostCam: Camera-Controllable Novel-View Video Generation with Query- Shared Cross-Attention","venue":"cs.CV","work_id":"973efba6-3687-421f-aa3e-0986acf3283b","year":2025},"citing_paper":{"arxiv_id":"2606.26087","last_updated":"2026-06-24T17:56:33Z","snapshot_observed_at":"2026-08-19T18:23:53.631746Z","submitted_at":"2026-06-24T17:56:33Z","title":"MVTrack4Gen: Multi-View Point Tracking as Geometric Supervision for 4D Video Generation","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-06-25T19:36:21.514445Z"},"links":{"cited_paper":"/paper/2511.17185","citing_paper":"/paper/2606.26087"},"observation_digest":"sha256:b7c1213ef32e3a77b9941704b23004efc89e4232dc34d40f3d125755f3e2f19f","observation_id":"2c79a029-c315-43c2-8609-1506297fdf73","resolution":{"observed_at":"2026-07-04T20:50:11.188941Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2511.17185","last_updated":"2026-05-29T08:17:11Z","snapshot_observed_at":"2026-08-03T21:01:05.108421Z","submitted_at":"2025-11-21T12:05:46Z","title":"PostCam: Camera-Controllable Novel-View Video Generation with Query-Shared Cross-Attention","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2511.17185","snapshot_observed_at":"2026-07-31T11:10:41.415757Z","title":"arXiv preprint arXiv:2511.17185 (2025)","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.24591","last_updated":"2026-07-27T15:55:08Z","snapshot_observed_at":"2026-08-14T08:22:39.737484Z","submitted_at":"2026-07-27T15:55:08Z","title":"CameraAnything: Refilming Videos with Arbitrary Camera Control","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-07-31T11:10:41.415757Z"},"links":{"cited_paper":"/paper/2511.17185","citing_paper":"/paper/2607.24591"},"observation_digest":"sha256:e1f581ea98811ae582c6e36cbef39305218b013949c9f91dd8af9d614adc2095","observation_id":"bd29cd42-28bc-4ea6-890e-c408a4857451","resolution":{"observed_at":"2026-07-31T11:10:41.415757Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"links":{"evidence":"/evidence","html":"/paper/2511.17185/citation-record","integrity":"/paper/2511.17185/integrity","json":"/paper/2511.17185/citation-record.json","paper":"/paper/2511.17185"},"outbound":[{"citation":{"cited_paper":{"arxiv_id":"2407.12781","last_updated":"2025-03-22T15:40:42Z","snapshot_observed_at":"2026-08-19T14:50:19.016025Z","submitted_at":"2024-07-17T17:59:05Z","title":"VD3D: Taming Large Video Diffusion Transformers for 3D Camera Control","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2407.12781","snapshot_observed_at":"2026-08-03T21:01:06.386578Z","title":"Vd3d: Taming large video diffu- sion transformers for 3d camera control.arXiv preprint arXiv:2407.12781, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2511.17185","last_updated":"2026-05-29T08:17:11Z","snapshot_observed_at":"2026-08-03T21:01:05.108421Z","submitted_at":"2025-11-21T12:05:46Z","title":"PostCam: Camera-Controllable Novel-View Video Generation with Query-Shared Cross-Attention","version":2},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-03T21:01:06.386578Z"},"links":{"cited_paper":"/paper/2407.12781","citing_paper":"/paper/2511.17185"},"observation_digest":"sha256:e12f82af15540643878ba9fb722b5d18611bbd63ac3a51bcb02f95cfc058e217","observation_id":"0d49eacd-0a98-44e6-b278-b848fcf9b09a","resolution":{"observed_at":"2026-08-03T21:01:06.386578Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T21:01:06.462941Z","title":"Ac3d: Analyzing and improving 3d camera control in video diffusion trans- formers","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2511.17185","last_updated":"2026-05-29T08:17:11Z","snapshot_observed_at":"2026-08-03T21:01:05.108421Z","submitted_at":"2025-11-21T12:05:46Z","title":"PostCam: Camera-Controllable Novel-View Video Generation with Query-Shared Cross-Attention","version":2},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-03T21:01:06.462941Z"},"links":{"citing_paper":"/paper/2511.17185"},"observation_digest":"sha256:01c95f80a1f4f13db148a3c0b5a4cf61334995d26360339735dae1a64c283c3b","observation_id":"621f1a46-e75e-4917-b3f6-9c6e757d14cd","resolution":{"observed_at":"2026-08-03T21:01:06.462941Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2503.11647","last_updated":"2025-07-09T08:09:06Z","snapshot_observed_at":"2026-08-21T05:42:50.086333Z","submitted_at":"2025-03-14T17:59:31Z","title":"ReCamMaster: Camera-Controlled Generative Rendering from A Single Video","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2503.11647","snapshot_observed_at":"2026-08-03T21:01:06.620560Z","title":"Recammaster: Camera-controlled generative rendering from a single video.arXiv preprint arXiv:2503.11647, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2511.17185","last_updated":"2026-05-29T08:17:11Z","snapshot_observed_at":"2026-08-03T21:01:05.108421Z","submitted_at":"2025-11-21T12:05:46Z","title":"PostCam: Camera-Controllable Novel-View Video Generation with Query-Shared Cross-Attention","version":2},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-03T21:01:06.620560Z"},"links":{"cited_paper":"/paper/2503.11647","citing_paper":"/paper/2511.17185"},"observation_digest":"sha256:8d47f66bf6a5fa6ae18243894cdd4274e19611f869620727e2dcb5dbfe498d53","observation_id":"9d81a507-3e67-4237-8739-4c2882156a65","resolution":{"observed_at":"2026-08-03T21:01:06.620560Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2501.02690","last_updated":"2025-01-05T23:55:33Z","snapshot_observed_at":"2026-08-21T17:37:24.376542Z","submitted_at":"2025-01-05T23:55:33Z","title":"GS-DiT: Advancing Video Generation with Pseudo 4D Gaussian Fields through Efficient Dense 3D Point Tracking","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2501.02690","snapshot_observed_at":"2026-08-03T21:01:06.699695Z","title":"Gs-dit: Advancing video generation with pseudo 4d gaussian fields through efficient dense 3d point tracking.arXiv preprint arXiv:2501.02690,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2511.17185","last_updated":"2026-05-29T08:17:11Z","snapshot_observed_at":"2026-08-03T21:01:05.108421Z","submitted_at":"2025-11-21T12:05:46Z","title":"PostCam: Camera-Controllable Novel-View Video Generation with Query-Shared Cross-Attention","version":2},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-03T21:01:06.699695Z"},"links":{"cited_paper":"/paper/2501.02690","citing_paper":"/paper/2511.17185"},"observation_digest":"sha256:4ba8b5ae8751f6268493a08272d2b750dc35d5144c65a9a8afa75e660dd4644c","observation_id":"edb73e95-bf3e-4f48-a8f9-b3f92a0381e6","resolution":{"observed_at":"2026-08-03T21:01:06.699695Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2311.15127","last_updated":"2023-11-25T22:28:38Z","snapshot_observed_at":"2026-08-20T09:39:07.545813Z","submitted_at":"2023-11-25T22:28:38Z","title":"Stable Video Diffusion: Scaling Latent Video Diffusion Models to Large Datasets","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2311.15127","snapshot_observed_at":"2026-08-03T21:01:06.754154Z","title":"Stable video diffusion: Scaling latent video diffusion models to large datasets.arXiv preprint arXiv:2311.15127, 2023","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2511.17185","last_updated":"2026-05-29T08:17:11Z","snapshot_observed_at":"2026-08-03T21:01:05.108421Z","submitted_at":"2025-11-21T12:05:46Z","title":"PostCam: Camera-Controllable Novel-View Video Generation with Query-Shared Cross-Attention","version":2},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-03T21:01:06.754154Z"},"links":{"cited_paper":"/paper/2311.15127","citing_paper":"/paper/2511.17185"},"observation_digest":"sha256:7e7ae6cf09ba6a2803fbb6ec89bcd359ad1672c76ae2fba0ddc5911609372a7d","observation_id":"843a13c5-ca58-4de9-b46c-3eb4446c2acd","resolution":{"observed_at":"2026-08-03T21:01:06.754154Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T21:01:06.935417Z","title":"Video generation models as world simulators.OpenAI Blog, 1:8, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2511.17185","last_updated":"2026-05-29T08:17:11Z","snapshot_observed_at":"2026-08-03T21:01:05.108421Z","submitted_at":"2025-11-21T12:05:46Z","title":"PostCam: Camera-Controllable Novel-View Video Generation with Query-Shared Cross-Attention","version":2},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-03T21:01:06.935417Z"},"links":{"citing_paper":"/paper/2511.17185"},"observation_digest":"sha256:267ef7e04e6ea6b9ba5bb18a6c715ce4d6038d62d21c0341c133e608eb58689c","observation_id":"db7baa48-53bd-40f0-9b12-58f51ad2ffb1","resolution":{"observed_at":"2026-08-03T21:01:06.935417Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T21:01:07.075598Z","title":"Mvgenmaster: Scaling multi-view generation from any image via 3d priors enhanced diffusion model","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2511.17185","last_updated":"2026-05-29T08:17:11Z","snapshot_observed_at":"2026-08-03T21:01:05.108421Z","submitted_at":"2025-11-21T12:05:46Z","title":"PostCam: Camera-Controllable Novel-View Video Generation with Query-Shared Cross-Attention","version":2},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-03T21:01:07.075598Z"},"links":{"citing_paper":"/paper/2511.17185"},"observation_digest":"sha256:c622820eeaa0bc6317c1f0244f5a851989b8df89ae194836e9b3dd6265dd11c1","observation_id":"9fd068d2-6c06-48a2-bbb5-a99b4d5a7ed7","resolution":{"observed_at":"2026-08-03T21:01:07.075598Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T21:01:07.187491Z","title":"Uni3c: Unifying precisely 3d-enhanced camera and hu- man motion controls for video generation.arXiv preprint arXiv:2504.14899, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2511.17185","last_updated":"2026-05-29T08:17:11Z","snapshot_observed_at":"2026-08-03T21:01:05.108421Z","submitted_at":"2025-11-21T12:05:46Z","title":"PostCam: Camera-Controllable Novel-View Video Generation with Query-Shared Cross-Attention","version":2},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-03T21:01:07.187491Z"},"links":{"citing_paper":"/paper/2511.17185"},"observation_digest":"sha256:0eec7035fa71146365fb1887f7380cd2f5d919e8bc2d0b9d627c14fe4c387d31","observation_id":"25678265-0723-4425-b316-d83bc8dfa672","resolution":{"observed_at":"2026-08-03T21:01:07.187491Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2411.06525","last_updated":"2025-02-28T06:40:38Z","snapshot_observed_at":"2026-08-20T05:00:40.094565Z","submitted_at":"2024-11-10T16:59:39Z","title":"I2VControl-Camera: Precise Video Camera Control with Adjustable Motion Strength","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2411.06525","snapshot_observed_at":"2026-08-03T21:01:07.233855Z","title":"I2vcontrol-camera: Precise video camera control with adjustable motion strength.arXiv preprint arXiv:2411.06525, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2511.17185","last_updated":"2026-05-29T08:17:11Z","snapshot_observed_at":"2026-08-03T21:01:05.108421Z","submitted_at":"2025-11-21T12:05:46Z","title":"PostCam: Camera-Controllable Novel-View Video Generation with Query-Shared Cross-Attention","version":2},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-03T21:01:07.233855Z"},"links":{"cited_paper":"/paper/2411.06525","citing_paper":"/paper/2511.17185"},"observation_digest":"sha256:8e4d2b61eb5e2a05f57847fe4ac6ce1c6b8f910d272e77a2b658f26fe881698b","observation_id":"7e86137a-9738-4a43-ba2f-412521d90e91","resolution":{"observed_at":"2026-08-03T21:01:07.233855Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2501.03847","last_updated":"2025-01-09T04:25:42Z","snapshot_observed_at":"2026-08-16T09:31:46.329467Z","submitted_at":"2025-01-07T15:01:58Z","title":"Diffusion as Shader: 3D-aware Video Diffusion for Versatile Video Generation Control","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2501.03847","snapshot_observed_at":"2026-08-03T21:01:07.329732Z","title":"Diffusion as shader: 3d-aware video diffu- sion for versatile video generation control.arXiv preprint arXiv:2501.03847, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2511.17185","last_updated":"2026-05-29T08:17:11Z","snapshot_observed_at":"2026-08-03T21:01:05.108421Z","submitted_at":"2025-11-21T12:05:46Z","title":"PostCam: Camera-Controllable Novel-View Video Generation with Query-Shared Cross-Attention","version":2},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-03T21:01:07.329732Z"},"links":{"cited_paper":"/paper/2501.03847","citing_paper":"/paper/2511.17185"},"observation_digest":"sha256:fb7506042e2c2eec65e858dd3af2515d8ba6d0016f6be60f4c8a87bec8ce7c0f","observation_id":"d2c47cc0-6550-45b4-9840-f52b4bc6f53a","resolution":{"observed_at":"2026-08-03T21:01:07.329732Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2307.04725","last_updated":"2024-02-08T18:08:57Z","snapshot_observed_at":"2026-08-17T14:04:31.230742Z","submitted_at":"2023-07-10T17:34:16Z","title":"AnimateDiff: Animate Your Personalized Text-to-Image Diffusion Models without Specific Tuning","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2307.04725","snapshot_observed_at":"2026-08-03T21:01:07.433226Z","title":"Animatediff: Animate your personalized text- to-image diffusion models without specific tuning.arXiv preprint arXiv:2307.04725, 2023","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2511.17185","last_updated":"2026-05-29T08:17:11Z","snapshot_observed_at":"2026-08-03T21:01:05.108421Z","submitted_at":"2025-11-21T12:05:46Z","title":"PostCam: Camera-Controllable Novel-View Video Generation with Query-Shared Cross-Attention","version":2},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-03T21:01:07.433226Z"},"links":{"cited_paper":"/paper/2307.04725","citing_paper":"/paper/2511.17185"},"observation_digest":"sha256:bec94fe40f683d5b8e942bbd7a1cffc0b45348249310e8e057c5222c4e53e3e4","observation_id":"17e0b4a3-dd67-47ba-9b80-bd3b33330a07","resolution":{"observed_at":"2026-08-03T21:01:07.433226Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2404.02101","last_updated":"2025-03-13T18:35:06Z","snapshot_observed_at":"2026-08-16T17:39:09.604516Z","submitted_at":"2024-04-02T16:52:41Z","title":"CameraCtrl: Enabling Camera Control for Text-to-Video Generation","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2404.02101","snapshot_observed_at":"2026-08-03T21:01:07.589419Z","title":"Cameractrl: Enabling camera control for text-to-video generation.arXiv preprint arXiv:2404.02101, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2511.17185","last_updated":"2026-05-29T08:17:11Z","snapshot_observed_at":"2026-08-03T21:01:05.108421Z","submitted_at":"2025-11-21T12:05:46Z","title":"PostCam: Camera-Controllable Novel-View Video Generation with Query-Shared Cross-Attention","version":2},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-03T21:01:07.589419Z"},"links":{"cited_paper":"/paper/2404.02101","citing_paper":"/paper/2511.17185"},"observation_digest":"sha256:08863e5ad90901a95b2eb285a3e94da208a94238ee9aec8f5cd640b5b4cb0999","observation_id":"6c26ed86-d911-4639-b3ba-81df5402e741","resolution":{"observed_at":"2026-08-03T21:01:07.589419Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2503.10592","last_updated":"2025-03-13T17:42:01Z","snapshot_observed_at":"2026-08-16T12:50:17.421166Z","submitted_at":"2025-03-13T17:42:01Z","title":"CameraCtrl II: Dynamic Scene Exploration via Camera-controlled Video Diffusion Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2503.10592","snapshot_observed_at":"2026-08-03T21:01:07.753225Z","title":"Cameractrl ii: Dynamic scene exploration via camera-controlled video diffusion models.arXiv preprint arXiv:2503.10592, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2511.17185","last_updated":"2026-05-29T08:17:11Z","snapshot_observed_at":"2026-08-03T21:01:05.108421Z","submitted_at":"2025-11-21T12:05:46Z","title":"PostCam: Camera-Controllable Novel-View Video Generation with Query-Shared Cross-Attention","version":2},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-03T21:01:07.753225Z"},"links":{"cited_paper":"/paper/2503.10592","citing_paper":"/paper/2511.17185"},"observation_digest":"sha256:d47ab8a9b40ede84c51838f3888af8a8efb3d36867069d4fc2488e7eedfe7340","observation_id":"051809f8-19b3-4fd4-a146-1baaaa651660","resolution":{"observed_at":"2026-08-03T21:01:07.753225Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T21:01:07.835628Z","title":"Video dif- fusion models.Advances in Neural Information Processing Systems, 35:8633–8646, 2022","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2511.17185","last_updated":"2026-05-29T08:17:11Z","snapshot_observed_at":"2026-08-03T21:01:05.108421Z","submitted_at":"2025-11-21T12:05:46Z","title":"PostCam: Camera-Controllable Novel-View Video Generation with Query-Shared Cross-Attention","version":2},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-03T21:01:07.835628Z"},"links":{"citing_paper":"/paper/2511.17185"},"observation_digest":"sha256:bdae6621d36bea935ad6df78b758acae7fec11eda15060d8c0088234d514d944","observation_id":"98d30fcf-5b72-4621-ae2b-6647f361bc69","resolution":{"observed_at":"2026-08-03T21:01:07.835628Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2406.10126","last_updated":"2025-02-25T00:32:29Z","snapshot_observed_at":"2026-08-22T03:09:26.395691Z","submitted_at":"2024-06-14T15:33:00Z","title":"Training-free Camera Control for Video Generation","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2406.10126","snapshot_observed_at":"2026-08-03T21:01:07.919357Z","title":"Training-free camera control for video generation.arXiv preprint arXiv:2406.10126, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2511.17185","last_updated":"2026-05-29T08:17:11Z","snapshot_observed_at":"2026-08-03T21:01:05.108421Z","submitted_at":"2025-11-21T12:05:46Z","title":"PostCam: Camera-Controllable Novel-View Video Generation with Query-Shared Cross-Attention","version":2},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-03T21:01:07.919357Z"},"links":{"cited_paper":"/paper/2406.10126","citing_paper":"/paper/2511.17185"},"observation_digest":"sha256:39eb12a94f5d05740b8edb3216ad88aa6b42d217dd3e01ce8495f5c6bcc6166a","observation_id":"4e6efd46-f60e-4fa3-97b0-9c7ac7628524","resolution":{"observed_at":"2026-08-03T21:01:07.919357Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2404.15789","last_updated":"2024-05-01T02:37:18Z","snapshot_observed_at":"2026-08-19T20:24:48.087116Z","submitted_at":"2024-04-24T10:28:54Z","title":"MotionMaster: Training-free Camera Motion Transfer For Video Generation","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2404.15789","snapshot_observed_at":"2026-08-03T21:01:07.988861Z","title":"Mo- tionmaster: Training-free camera motion transfer for video generation.arXiv preprint arXiv:2404.15789, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2511.17185","last_updated":"2026-05-29T08:17:11Z","snapshot_observed_at":"2026-08-03T21:01:05.108421Z","submitted_at":"2025-11-21T12:05:46Z","title":"PostCam: Camera-Controllable Novel-View Video Generation with Query-Shared Cross-Attention","version":2},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-03T21:01:07.988861Z"},"links":{"cited_paper":"/paper/2404.15789","citing_paper":"/paper/2511.17185"},"observation_digest":"sha256:486c360c277268471fbd200436544d004dcb2d15423eeda4674ce4f495fabd03","observation_id":"992fff34-18be-4e0b-8166-4e185bd29031","resolution":{"observed_at":"2026-08-03T21:01:07.988861Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T21:01:08.051114Z","title":"Vbench: Comprehensive bench- mark suite for video generative models","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2511.17185","last_updated":"2026-05-29T08:17:11Z","snapshot_observed_at":"2026-08-03T21:01:05.108421Z","submitted_at":"2025-11-21T12:05:46Z","title":"PostCam: Camera-Controllable Novel-View Video Generation with Query-Shared Cross-Attention","version":2},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-03T21:01:08.051114Z"},"links":{"citing_paper":"/paper/2511.17185"},"observation_digest":"sha256:c2c63762284c33c4c5e851a1e1a7f19721fcc7433167902c2ac294df0af786e4","observation_id":"2d1bf0c7-2d09-4b10-88f6-63ee532c130c","resolution":{"observed_at":"2026-08-03T21:01:08.051114Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2412.03603","last_updated":"2025-03-11T08:14:25Z","snapshot_observed_at":"2026-08-17T07:44:10.213698Z","submitted_at":"2024-12-03T23:52:37Z","title":"HunyuanVideo: A Systematic Framework For Large Video Generative Models","version":6},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2412.03603","snapshot_observed_at":"2026-08-03T21:01:08.144786Z","title":"Hunyuanvideo: A systematic framework for large video generative models.arXiv preprint arXiv:2412.03603, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2511.17185","last_updated":"2026-05-29T08:17:11Z","snapshot_observed_at":"2026-08-03T21:01:05.108421Z","submitted_at":"2025-11-21T12:05:46Z","title":"PostCam: Camera-Controllable Novel-View Video Generation with Query-Shared Cross-Attention","version":2},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-03T21:01:08.144786Z"},"links":{"cited_paper":"/paper/2412.03603","citing_paper":"/paper/2511.17185"},"observation_digest":"sha256:47f47188a742f5bd2116c7073ea35f2eb2f4a3ee3cd177e846faf4f97c50c509","observation_id":"3ad9ba29-fd5d-4b66-9abd-9d67ea5f28ae","resolution":{"observed_at":"2026-08-03T21:01:08.144786Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T21:01:08.207231Z","title":"Collab- orative video diffusion: Consistent multi-video generation with camera control.Advances in Neural Information Pro- cessing Systems, 37:16240–16271, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2511.17185","last_updated":"2026-05-29T08:17:11Z","snapshot_observed_at":"2026-08-03T21:01:05.108421Z","submitted_at":"2025-11-21T12:05:46Z","title":"PostCam: Camera-Controllable Novel-View Video Generation with Query-Shared Cross-Attention","version":2},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-03T21:01:08.207231Z"},"links":{"citing_paper":"/paper/2511.17185"},"observation_digest":"sha256:50c04bcd7da1d9edb9d1b9662d7efd3649a8a471f2fdcf863a6c79b8916f7df0","observation_id":"a32e1fed-9f42-407f-94bd-cf4334eaa280","resolution":{"observed_at":"2026-08-03T21:01:08.207231Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2502.10059","last_updated":"2025-07-13T08:12:15Z","snapshot_observed_at":"2026-08-17T20:10:03.387661Z","submitted_at":"2025-02-14T10:21:49Z","title":"RealCam-I2V: Real-World Image-to-Video Generation with Interactive Complex Camera Control","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2502.10059","snapshot_observed_at":"2026-08-03T21:01:08.294175Z","title":"Realcam-i2v: Real-world image-to- video generation with interactive complex camera control","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2511.17185","last_updated":"2026-05-29T08:17:11Z","snapshot_observed_at":"2026-08-03T21:01:05.108421Z","submitted_at":"2025-11-21T12:05:46Z","title":"PostCam: Camera-Controllable Novel-View Video Generation with Query-Shared Cross-Attention","version":2},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-03T21:01:08.294175Z"},"links":{"cited_paper":"/paper/2502.10059","citing_paper":"/paper/2511.17185"},"observation_digest":"sha256:384a6a92e446a4789b20768cb77094c03723679c6d27a5ed544f282a49a9b075","observation_id":"2802c1a3-9967-4d99-b519-26a9dde2b0aa","resolution":{"observed_at":"2026-08-03T21:01:08.294175Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T21:01:08.356000Z","title":"Wonderland: Navi- gating 3d scenes from a single image","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2511.17185","last_updated":"2026-05-29T08:17:11Z","snapshot_observed_at":"2026-08-03T21:01:05.108421Z","submitted_at":"2025-11-21T12:05:46Z","title":"PostCam: Camera-Controllable Novel-View Video Generation with Query-Shared Cross-Attention","version":2},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-03T21:01:08.356000Z"},"links":{"citing_paper":"/paper/2511.17185"},"observation_digest":"sha256:8cce4f92129eed30a40e215b2ae205b8ddfc49a6ce0c3690cbf6ac71ee44fc17","observation_id":"0aa06f3d-3ca2-4e32-a87d-db54aadd27c8","resolution":{"observed_at":"2026-08-03T21:01:08.356000Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2406.05338","last_updated":"2024-10-22T04:22:16Z","snapshot_observed_at":"2026-08-16T13:44:59.124353Z","submitted_at":"2024-06-08T03:44:25Z","title":"MotionClone: Training-Free Motion Cloning for Controllable Video Generation","version":6},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2406.05338","snapshot_observed_at":"2026-08-03T21:01:08.419049Z","title":"Motionclone: Training-free motion cloning for controllable video generation.arXiv preprint arXiv:2406.05338, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2511.17185","last_updated":"2026-05-29T08:17:11Z","snapshot_observed_at":"2026-08-03T21:01:05.108421Z","submitted_at":"2025-11-21T12:05:46Z","title":"PostCam: Camera-Controllable Novel-View Video Generation with Query-Shared Cross-Attention","version":2},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-03T21:01:08.419049Z"},"links":{"cited_paper":"/paper/2406.05338","citing_paper":"/paper/2511.17185"},"observation_digest":"sha256:2ad1da996b85d6034cb2f70916a61231a4aa3a1554d8d7d938261b1bcdc29e75","observation_id":"846ecf1e-54c1-4a29-bb1e-d3675b4cbcad","resolution":{"observed_at":"2026-08-03T21:01:08.419049Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2210.02747","last_updated":"2023-02-08T15:46:05Z","snapshot_observed_at":"2026-08-16T02:30:42.660030Z","submitted_at":"2022-10-06T08:32:20Z","title":"Flow Matching for Generative Modeling","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2210.02747","snapshot_observed_at":"2026-08-03T21:01:08.605544Z","title":"Flow matching for generative mod- eling.arXiv preprint arXiv:2210.02747, 2022","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2511.17185","last_updated":"2026-05-29T08:17:11Z","snapshot_observed_at":"2026-08-03T21:01:05.108421Z","submitted_at":"2025-11-21T12:05:46Z","title":"PostCam: Camera-Controllable Novel-View Video Generation with Query-Shared Cross-Attention","version":2},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-03T21:01:08.605544Z"},"links":{"cited_paper":"/paper/2210.02747","citing_paper":"/paper/2511.17185"},"observation_digest":"sha256:8baed15866bca3b772808e4a73f663ab4ddfd82e9b40893be4fbb7ccb9429a61","observation_id":"6f0ca84e-bbe5-40cb-95ce-7a9b84028b22","resolution":{"observed_at":"2026-08-03T21:01:08.605544Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2503.05638","last_updated":"2025-03-07T17:57:53Z","snapshot_observed_at":"2026-08-16T12:52:05.912150Z","submitted_at":"2025-03-07T17:57:53Z","title":"TrajectoryCrafter: Redirecting Camera Trajectory for Monocular Videos via Diffusion Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2503.05638","snapshot_observed_at":"2026-08-03T21:01:08.733360Z","title":"Tra- jectorycrafter: Redirecting camera trajectory for monoc- ular videos via diffusion models.arXiv preprint arXiv:2503.05638, 2, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2511.17185","last_updated":"2026-05-29T08:17:11Z","snapshot_observed_at":"2026-08-03T21:01:05.108421Z","submitted_at":"2025-11-21T12:05:46Z","title":"PostCam: Camera-Controllable Novel-View Video Generation with Query-Shared Cross-Attention","version":2},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-03T21:01:08.733360Z"},"links":{"cited_paper":"/paper/2503.05638","citing_paper":"/paper/2511.17185"},"observation_digest":"sha256:9050820b4a3d6044648456de1524f145c51c36c750abfd40cb9f95a499d41670","observation_id":"aeaf5e6f-4d8f-4ccb-8591-5bed754021d5","resolution":{"observed_at":"2026-08-03T21:01:08.733360Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T21:01:08.901669Z","title":"Multidiff: Consistent novel view synthesis from a single image","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2511.17185","last_updated":"2026-05-29T08:17:11Z","snapshot_observed_at":"2026-08-03T21:01:05.108421Z","submitted_at":"2025-11-21T12:05:46Z","title":"PostCam: Camera-Controllable Novel-View Video Generation with Query-Shared Cross-Attention","version":2},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-08-03T21:01:08.901669Z"},"links":{"citing_paper":"/paper/2511.17185"},"observation_digest":"sha256:a13a9b66467c71551e8405294464f3aae37f010bd65c35818ce0fde0345f009a","observation_id":"396dcf10-02d1-4c6f-b97c-2f75a8a1ec86","resolution":{"observed_at":"2026-08-03T21:01:08.901669Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2407.02371","last_updated":"2025-02-13T10:13:24Z","snapshot_observed_at":"2026-08-07T10:03:56.902190Z","submitted_at":"2024-07-02T15:40:29Z","title":"OpenVid-1M: A Large-Scale High-Quality Dataset for Text-to-video Generation","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2407.02371","snapshot_observed_at":"2026-08-03T21:01:09.013472Z","title":"Openvid-1m: A large-scale high-quality dataset for text-to- video generation.arXiv preprint arXiv:2407.02371, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2511.17185","last_updated":"2026-05-29T08:17:11Z","snapshot_observed_at":"2026-08-03T21:01:05.108421Z","submitted_at":"2025-11-21T12:05:46Z","title":"PostCam: Camera-Controllable Novel-View Video Generation with Query-Shared Cross-Attention","version":2},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-08-03T21:01:09.013472Z"},"links":{"cited_paper":"/paper/2407.02371","citing_paper":"/paper/2511.17185"},"observation_digest":"sha256:542443060acd0b953bd29849fcdbaf1125f7171fe3eb3bef7ce4377fbcbffb3d","observation_id":"f631fa7f-8fb8-4080-950f-8c5c500c78e1","resolution":{"observed_at":"2026-08-03T21:01:09.013472Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T21:01:09.143480Z","title":"Scalable diffusion models with transformers","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2511.17185","last_updated":"2026-05-29T08:17:11Z","snapshot_observed_at":"2026-08-03T21:01:05.108421Z","submitted_at":"2025-11-21T12:05:46Z","title":"PostCam: Camera-Controllable Novel-View Video Generation with Query-Shared Cross-Attention","version":2},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-08-03T21:01:09.143480Z"},"links":{"citing_paper":"/paper/2511.17185"},"observation_digest":"sha256:7104cc9e472e65ceacbd6bfa44a95b2533809386bda90a5003235293f7bc46b0","observation_id":"ff9f9768-a8b3-4a90-8549-7b390c6de69e","resolution":{"observed_at":"2026-08-03T21:01:09.143480Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2501.06006","last_updated":"2025-01-31T17:26:57Z","snapshot_observed_at":"2026-08-20T12:47:33.366225Z","submitted_at":"2025-01-10T14:37:32Z","title":"CamCtrl3D: Single-Image Scene Exploration with Precise 3D Camera Control","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2501.06006","snapshot_observed_at":"2026-08-03T21:01:09.243860Z","title":"Camctrl3d: Single-image scene exploration with precise 3d camera con- trol.arXiv preprint arXiv:2501.06006, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2511.17185","last_updated":"2026-05-29T08:17:11Z","snapshot_observed_at":"2026-08-03T21:01:05.108421Z","submitted_at":"2025-11-21T12:05:46Z","title":"PostCam: Camera-Controllable Novel-View Video Generation with Query-Shared Cross-Attention","version":2},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-08-03T21:01:09.243860Z"},"links":{"cited_paper":"/paper/2501.06006","citing_paper":"/paper/2511.17185"},"observation_digest":"sha256:d85fb13f61441c45987df0fd8e37ff037ef9a10dfd599a0d82e6c57f09a1a499","observation_id":"fceedd1c-4928-42cf-a0ef-0a45cb5ee4f2","resolution":{"observed_at":"2026-08-03T21:01:09.243860Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T21:01:09.372364Z","title":"Gen3c: 3d-informed world-consistent video generation with precise camera con- trol","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2511.17185","last_updated":"2026-05-29T08:17:11Z","snapshot_observed_at":"2026-08-03T21:01:05.108421Z","submitted_at":"2025-11-21T12:05:46Z","title":"PostCam: Camera-Controllable Novel-View Video Generation with Query-Shared Cross-Attention","version":2},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-08-03T21:01:09.372364Z"},"links":{"citing_paper":"/paper/2511.17185"},"observation_digest":"sha256:691d8399e9a8e220aa675bd09640fc4c302980d5a26d0d6dfcd1df1583059b36","observation_id":"fea8352e-c1e1-401e-a8b2-1d0e50c5db5f","resolution":{"observed_at":"2026-08-03T21:01:09.372364Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2209.14792","last_updated":"2022-09-29T13:59:46Z","snapshot_observed_at":"2026-07-06T13:57:47.051387Z","submitted_at":"2022-09-29T13:59:46Z","title":"Make-A-Video: Text-to-Video Generation without Text-Video Data","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2209.14792","snapshot_observed_at":"2026-08-03T21:01:09.487841Z","title":"Make-a-video: Text-to-video generation without text-video data.arXiv preprint arXiv:2209.14792,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2511.17185","last_updated":"2026-05-29T08:17:11Z","snapshot_observed_at":"2026-08-03T21:01:05.108421Z","submitted_at":"2025-11-21T12:05:46Z","title":"PostCam: Camera-Controllable Novel-View Video Generation with Query-Shared Cross-Attention","version":2},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-08-03T21:01:09.487841Z"},"links":{"cited_paper":"/paper/2209.14792","citing_paper":"/paper/2511.17185"},"observation_digest":"sha256:2c0180f2f57647370381e431fe572918e7ff6d4fdf1b53e6be9fb7d523510967","observation_id":"a4e9d4f9-aef0-45b8-9b75-2c1916c29de0","resolution":{"observed_at":"2026-08-03T21:01:09.487841Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T21:01:09.577266Z","title":"Generative camera dolly: Ex- treme monocular dynamic novel view synthesis","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2511.17185","last_updated":"2026-05-29T08:17:11Z","snapshot_observed_at":"2026-08-03T21:01:05.108421Z","submitted_at":"2025-11-21T12:05:46Z","title":"PostCam: Camera-Controllable Novel-View Video Generation with Query-Shared Cross-Attention","version":2},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-08-03T21:01:09.577266Z"},"links":{"citing_paper":"/paper/2511.17185"},"observation_digest":"sha256:838f9a541afd532a3c4b807d30afe191a5b5b0ec53826f3c35d1b406d8f16187","observation_id":"f8a5d067-e720-4e45-a870-69b984201bb3","resolution":{"observed_at":"2026-08-03T21:01:09.577266Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2503.20314","last_updated":"2025-04-19T02:22:42Z","snapshot_observed_at":"2026-08-12T22:34:51.361078Z","submitted_at":"2025-03-26T08:25:43Z","title":"Wan: Open and Advanced Large-Scale Video Generative Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2503.20314","snapshot_observed_at":"2026-08-03T21:01:09.648117Z","title":"Wan: Open and advanced large-scale video gen- erative models.arXiv preprint arXiv:2503.20314, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2511.17185","last_updated":"2026-05-29T08:17:11Z","snapshot_observed_at":"2026-08-03T21:01:05.108421Z","submitted_at":"2025-11-21T12:05:46Z","title":"PostCam: Camera-Controllable Novel-View Video Generation with Query-Shared Cross-Attention","version":2},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-08-03T21:01:09.648117Z"},"links":{"cited_paper":"/paper/2503.20314","citing_paper":"/paper/2511.17185"},"observation_digest":"sha256:d8b8b90948d9a094a3465cc03e1d601c8fbe02a2c7d4ab52cf737d31a9fc77a5","observation_id":"7d9c1d0d-62c9-408e-b6fc-44ee1bb0e922","resolution":{"observed_at":"2026-08-03T21:01:09.648117Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2412.01429","last_updated":"2024-12-02T12:10:00Z","snapshot_observed_at":"2026-08-15T11:14:44.922577Z","submitted_at":"2024-12-02T12:10:00Z","title":"CPA: Camera-pose-awareness Diffusion Transformer for Video Generation","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2412.01429","snapshot_observed_at":"2026-08-03T21:01:09.717580Z","title":"Cpa: Camera-pose-awareness dif- fusion transformer for video generation.arXiv preprint arXiv:2412.01429, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2511.17185","last_updated":"2026-05-29T08:17:11Z","snapshot_observed_at":"2026-08-03T21:01:05.108421Z","submitted_at":"2025-11-21T12:05:46Z","title":"PostCam: Camera-Controllable Novel-View Video Generation with Query-Shared Cross-Attention","version":2},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-08-03T21:01:09.717580Z"},"links":{"cited_paper":"/paper/2412.01429","citing_paper":"/paper/2511.17185"},"observation_digest":"sha256:1758208c88b603a55df93f9d0aa355b67d485166fc11106eca89d771f71aaf8a","observation_id":"2da49068-e7c5-4b66-9210-16ef64f8daaa","resolution":{"observed_at":"2026-08-03T21:01:09.717580Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T21:01:09.741441Z","title":"Motionctrl: A unified and flexible motion controller for video generation","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2511.17185","last_updated":"2026-05-29T08:17:11Z","snapshot_observed_at":"2026-08-03T21:01:05.108421Z","submitted_at":"2025-11-21T12:05:46Z","title":"PostCam: Camera-Controllable Novel-View Video Generation with Query-Shared Cross-Attention","version":2},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-08-03T21:01:09.741441Z"},"links":{"citing_paper":"/paper/2511.17185"},"observation_digest":"sha256:65d5e13f7b2681fc191fc488e4e98090a69bbcb07f86323d865d0aeb13096d5c","observation_id":"205f8e16-3531-4cd4-9444-650173522c23","resolution":{"observed_at":"2026-08-03T21:01:09.741441Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2411.19324","last_updated":"2024-11-28T18:59:51Z","snapshot_observed_at":"2026-08-17T15:25:09.988792Z","submitted_at":"2024-11-28T18:59:51Z","title":"Trajectory Attention for Fine-grained Video Motion Control","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2411.19324","snapshot_observed_at":"2026-08-03T21:01:09.794702Z","title":"Trajectory atten- tion for fine-grained video motion control.arXiv preprint arXiv:2411.19324, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2511.17185","last_updated":"2026-05-29T08:17:11Z","snapshot_observed_at":"2026-08-03T21:01:05.108421Z","submitted_at":"2025-11-21T12:05:46Z","title":"PostCam: Camera-Controllable Novel-View Video Generation with Query-Shared Cross-Attention","version":2},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-08-03T21:01:09.794702Z"},"links":{"cited_paper":"/paper/2411.19324","citing_paper":"/paper/2511.17185"},"observation_digest":"sha256:98d85fef915cd0af10da9a3a5de0048082da719b2296332d8ff6de22ee46705a","observation_id":"30220acf-b2e4-41ee-9652-b51bf3ffafb1","resolution":{"observed_at":"2026-08-03T21:01:09.794702Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2405.14864","last_updated":"2024-11-12T01:31:41Z","snapshot_observed_at":"2026-08-16T13:50:03.452370Z","submitted_at":"2024-05-23T17:59:40Z","title":"Video Diffusion Models are Training-free Motion Interpreter and Controller","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2405.14864","snapshot_observed_at":"2026-08-03T21:01:09.889425Z","title":"Video diffusion models are training-free motion interpreter and controller.arXiv preprint arXiv:2405.14864, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2511.17185","last_updated":"2026-05-29T08:17:11Z","snapshot_observed_at":"2026-08-03T21:01:05.108421Z","submitted_at":"2025-11-21T12:05:46Z","title":"PostCam: Camera-Controllable Novel-View Video Generation with Query-Shared Cross-Attention","version":2},"reference_index":36,"source":"pdf_text","source_observed_at":"2026-08-03T21:01:09.889425Z"},"links":{"cited_paper":"/paper/2405.14864","citing_paper":"/paper/2511.17185"},"observation_digest":"sha256:6ac3db725893c4e2bbb6d3504e2443cfa2d05270d0748291f558460ba61ed6ac","observation_id":"fc95a1df-a73f-4ac5-a2ae-39837a7c294e","resolution":{"observed_at":"2026-08-03T21:01:09.889425Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2406.02509","last_updated":"2024-06-04T17:27:19Z","snapshot_observed_at":"2026-08-21T19:57:02.214817Z","submitted_at":"2024-06-04T17:27:19Z","title":"CamCo: Camera-Controllable 3D-Consistent Image-to-Video Generation","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2406.02509","snapshot_observed_at":"2026-08-03T21:01:09.977882Z","title":"Camco: Camera- controllable 3d-consistent image-to-video generation.arXiv preprint arXiv:2406.02509, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2511.17185","last_updated":"2026-05-29T08:17:11Z","snapshot_observed_at":"2026-08-03T21:01:05.108421Z","submitted_at":"2025-11-21T12:05:46Z","title":"PostCam: Camera-Controllable Novel-View Video Generation with Query-Shared Cross-Attention","version":2},"reference_index":37,"source":"pdf_text","source_observed_at":"2026-08-03T21:01:09.977882Z"},"links":{"cited_paper":"/paper/2406.02509","citing_paper":"/paper/2511.17185"},"observation_digest":"sha256:3815f4d9462f3bdc23d01a2b98c0b6823757dd128890472f294526ca5278c075","observation_id":"dd862312-5517-4a85-aa4a-e184f1756f01","resolution":{"observed_at":"2026-08-03T21:01:09.977882Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2408.06072","last_updated":"2025-03-26T08:33:10Z","snapshot_observed_at":"2026-08-15T19:52:28.153954Z","submitted_at":"2024-08-12T11:47:11Z","title":"CogVideoX: Text-to-Video Diffusion Models with An Expert Transformer","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2408.06072","snapshot_observed_at":"2026-08-03T21:01:10.079490Z","title":"Cogvideox: Text-to-video diffusion models with an expert transformer.arXiv preprint arXiv:2408.06072, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2511.17185","last_updated":"2026-05-29T08:17:11Z","snapshot_observed_at":"2026-08-03T21:01:05.108421Z","submitted_at":"2025-11-21T12:05:46Z","title":"PostCam: Camera-Controllable Novel-View Video Generation with Query-Shared Cross-Attention","version":2},"reference_index":38,"source":"pdf_text","source_observed_at":"2026-08-03T21:01:10.079490Z"},"links":{"cited_paper":"/paper/2408.06072","citing_paper":"/paper/2511.17185"},"observation_digest":"sha256:2a5ba2dd0cc653b2d30ead7196a9d0fc4c7bea5de3bb8f20ac83c5d43e856ef8","observation_id":"26596c49-7314-4b4e-b301-058d805b9c70","resolution":{"observed_at":"2026-08-03T21:01:10.079490Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2506.08004","last_updated":"2025-06-09T17:59:47Z","snapshot_observed_at":"2026-08-20T22:31:28.771046Z","submitted_at":"2025-06-09T17:59:47Z","title":"Dynamic View Synthesis as an Inverse Problem","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2506.08004","snapshot_observed_at":"2026-08-03T21:01:10.207947Z","title":"Dynamic view synthe- sis as an inverse problem.arXiv preprint arXiv:2506.08004,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2511.17185","last_updated":"2026-05-29T08:17:11Z","snapshot_observed_at":"2026-08-03T21:01:05.108421Z","submitted_at":"2025-11-21T12:05:46Z","title":"PostCam: Camera-Controllable Novel-View Video Generation with Query-Shared Cross-Attention","version":2},"reference_index":39,"source":"pdf_text","source_observed_at":"2026-08-03T21:01:10.207947Z"},"links":{"cited_paper":"/paper/2506.08004","citing_paper":"/paper/2511.17185"},"observation_digest":"sha256:34031d9564bdd504856584eeb384b6eeb2899a803cae560c336478b3f2cff711","observation_id":"eff63027-832f-457c-83f6-b629ca8429b8","resolution":{"observed_at":"2026-08-03T21:01:10.207947Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2409.02048","last_updated":"2024-09-03T16:53:19Z","snapshot_observed_at":"2026-08-14T12:22:44.567374Z","submitted_at":"2024-09-03T16:53:19Z","title":"ViewCrafter: Taming Video Diffusion Models for High-fidelity Novel View Synthesis","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2409.02048","snapshot_observed_at":"2026-08-03T21:01:10.278230Z","title":"Viewcrafter: Taming video diffusion models for high-fidelity novel view synthesis.arXiv preprint arXiv:2409.02048, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2511.17185","last_updated":"2026-05-29T08:17:11Z","snapshot_observed_at":"2026-08-03T21:01:05.108421Z","submitted_at":"2025-11-21T12:05:46Z","title":"PostCam: Camera-Controllable Novel-View Video Generation with Query-Shared Cross-Attention","version":2},"reference_index":40,"source":"pdf_text","source_observed_at":"2026-08-03T21:01:10.278230Z"},"links":{"cited_paper":"/paper/2409.02048","citing_paper":"/paper/2511.17185"},"observation_digest":"sha256:2a6c16a8effd0465a6105d571adc2827c56476eb3650af0a49a7eb4460a60e73","observation_id":"8a2ec8ad-8755-4884-9e61-294463fe4d0b","resolution":{"observed_at":"2026-08-03T21:01:10.278230Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2501.05763","last_updated":"2025-04-13T06:21:42Z","snapshot_observed_at":"2026-08-16T12:59:22.094132Z","submitted_at":"2025-01-10T07:41:47Z","title":"StarGen: A Spatiotemporal Autoregression Framework with Video Diffusion Model for Scalable and Controllable Scene Generation","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2501.05763","snapshot_observed_at":"2026-08-03T21:01:10.379545Z","title":"Stargen: A spatiotemporal autoregression framework with video diffusion model for scalable and con- trollable scene generation.arXiv preprint arXiv:2501.05763,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2511.17185","last_updated":"2026-05-29T08:17:11Z","snapshot_observed_at":"2026-08-03T21:01:05.108421Z","submitted_at":"2025-11-21T12:05:46Z","title":"PostCam: Camera-Controllable Novel-View Video Generation with Query-Shared Cross-Attention","version":2},"reference_index":41,"source":"pdf_text","source_observed_at":"2026-08-03T21:01:10.379545Z"},"links":{"cited_paper":"/paper/2501.05763","citing_paper":"/paper/2511.17185"},"observation_digest":"sha256:556eddac3e92408b4eb5e43069170958bec6e29a300dd472ae71a659e351fd08","observation_id":"fcaa4e04-7e6c-4d8b-a209-44a86231c455","resolution":{"observed_at":"2026-08-03T21:01:10.379545Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T21:01:10.442021Z","title":"Recapture: Gener- ative video camera controls for user-provided videos using masked video fine-tuning","venue":null,"work_id":null,"year":2050},"citing_paper":{"arxiv_id":"2511.17185","last_updated":"2026-05-29T08:17:11Z","snapshot_observed_at":"2026-08-03T21:01:05.108421Z","submitted_at":"2025-11-21T12:05:46Z","title":"PostCam: Camera-Controllable Novel-View Video Generation with Query-Shared Cross-Attention","version":2},"reference_index":42,"source":"pdf_text","source_observed_at":"2026-08-03T21:01:10.442021Z"},"links":{"citing_paper":"/paper/2511.17185"},"observation_digest":"sha256:b7d7351a1ae90129082a5aa2f738746f64729bd8e9ab59b2541e9d32b3c53612","observation_id":"263459ec-b2a8-4b0c-aecc-e6222d9ef529","resolution":{"observed_at":"2026-08-03T21:01:10.442021Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2410.15957","last_updated":"2024-12-04T12:54:44Z","snapshot_observed_at":"2026-08-20T05:26:36.217850Z","submitted_at":"2024-10-21T12:36:27Z","title":"CamI2V: Camera-Controlled Image-to-Video Diffusion Model","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2410.15957","snapshot_observed_at":"2026-08-03T21:01:10.508086Z","title":"Cami2v: Camera-controlled image-to-video dif- fusion model.arXiv preprint arXiv:2410.15957, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2511.17185","last_updated":"2026-05-29T08:17:11Z","snapshot_observed_at":"2026-08-03T21:01:05.108421Z","submitted_at":"2025-11-21T12:05:46Z","title":"PostCam: Camera-Controllable Novel-View Video Generation with Query-Shared Cross-Attention","version":2},"reference_index":43,"source":"pdf_text","source_observed_at":"2026-08-03T21:01:10.508086Z"},"links":{"cited_paper":"/paper/2410.15957","citing_paper":"/paper/2511.17185"},"observation_digest":"sha256:2769ad7fdbd0970210114bfc18654e5a439d108d6f2ebc4541beda6589806055","observation_id":"5f398621-9666-4553-a647-192282fa0374","resolution":{"observed_at":"2026-08-03T21:01:10.508086Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2412.20404","last_updated":"2024-12-29T08:52:49Z","snapshot_observed_at":"2026-08-20T23:16:18.586164Z","submitted_at":"2024-12-29T08:52:49Z","title":"Open-Sora: Democratizing Efficient Video Production for All","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2412.20404","snapshot_observed_at":"2026-08-03T21:01:10.584591Z","title":"Open-sora: Democratizing efficient video production for all.arXiv preprint arXiv:2412.20404, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2511.17185","last_updated":"2026-05-29T08:17:11Z","snapshot_observed_at":"2026-08-03T21:01:05.108421Z","submitted_at":"2025-11-21T12:05:46Z","title":"PostCam: Camera-Controllable Novel-View Video Generation with Query-Shared Cross-Attention","version":2},"reference_index":44,"source":"pdf_text","source_observed_at":"2026-08-03T21:01:10.584591Z"},"links":{"cited_paper":"/paper/2412.20404","citing_paper":"/paper/2511.17185"},"observation_digest":"sha256:09df219e639d119ee19a0c55bb9ba7f666733f516d3644a04a69e8e2e68c6d06","observation_id":"cf00d3ec-6dbc-4270-b5b4-e957cffc9df7","resolution":{"observed_at":"2026-08-03T21:01:10.584591Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"paper":{"arxiv_id":"2511.17185","last_updated":"2026-05-29T08:17:11Z","latest_version":2,"primary_category":"cs.CV","snapshot_observed_at":"2026-08-03T21:01:05.108421Z","submitted_at":"2025-11-21T12:05:46Z","title":"PostCam: Camera-Controllable Novel-View Video Generation with Query-Shared Cross-Attention"},"reference_resolution":{"displayed":44,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":44,"verified_exact":0,"verified_fuzzy":0},"total_outbound_references":44},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"thesis":"As of 22 August 2026, this Paper Citation Record lists 44 of 44 outbound references and 3 inbound Pith citation observations for arXiv:2511.17185."}