{"as_of":"2026-08-14T01:27:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:3ce4ba2849ba957184ec4525b3a0061fce7866fe35ba47307d4e3a242cfb0d0f","coverage":[{"denominator":55,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":55,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-11T20:09:26.217767Z","state":"measured"},{"denominator":56,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":56,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-13T06:32:02.005865+00:00","state":"measured"},{"denominator":1,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":1,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-07T13:28:15.758987Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"pith","source_observed_at":"2026-08-07T13:28:15.841296Z","state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2412.06029","last_updated":"2024-12-08T18:59:54Z","snapshot_observed_at":"2026-08-13T13:48:07.666011Z","submitted_at":"2024-12-08T18:59:54Z","title":"Latent-Reframe: Enabling Camera Control for Video Diffusion Model without Training","version":1},"cited_work":{"arxiv_id":"2412.06029","doi":null,"metadata_source":"pith","pith_arxiv_id":"2412.06029","snapshot_observed_at":"2026-08-07T13:28:15.841296Z","title":"Latent-Reframe: Enabling Camera Control for Video Diffusion Model without Training","venue":"cs.CV","work_id":"e801f6c3-e1d9-4224-b2df-af69297dab59","year":2024},"citing_paper":{"arxiv_id":"2505.21876","last_updated":"2026-05-28T08:11:37Z","snapshot_observed_at":"2026-08-07T13:18:12.902974Z","submitted_at":"2025-05-28T01:45:26Z","title":"EPiC: Efficient Video Camera Control Learning with Precise Anchor-Video Guidance","version":2},"reference_index":86,"source":"pdf_text","source_observed_at":"2026-08-07T13:28:15.758987Z"},"links":{"cited_paper":"/paper/2412.06029","citing_paper":"/paper/2505.21876"},"observation_digest":"sha256:d6c644a1bda718c239e63feb712e7cf63ceb612f73615a2c0e1a932e452b4e75","observation_id":"caa02212-344e-4660-858c-66f50bb2be53","resolution":{"observed_at":"2026-08-07T13:28:15.897713Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}}],"links":{"evidence":"/evidence","html":"/paper/2412.06029/citation-record","integrity":"/paper/2412.06029/integrity","json":"/paper/2412.06029/citation-record.json","paper":"/paper/2412.06029"},"outbound":[{"citation":{"cited_paper":{"arxiv_id":"2304.08477","last_updated":"2023-04-18T03:27:52Z","snapshot_observed_at":"2026-08-13T21:55:34.606308Z","submitted_at":"2023-04-17T17:57:06Z","title":"Latent-Shift: Latent Diffusion with Temporal Shift for Efficient Text-to-Video Generation","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2304.08477","snapshot_observed_at":"2026-08-11T20:09:26.059474Z","title":"Latent-Shift: Latent Diffu- sion with Temporal Shift for Efficient Text-to-Video Gener- ation","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2412.06029","last_updated":"2024-12-08T18:59:54Z","snapshot_observed_at":"2026-08-13T13:48:07.666011Z","submitted_at":"2024-12-08T18:59:54Z","title":"Latent-Reframe: Enabling Camera Control for Video Diffusion Model without Training","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-11T20:09:26.059474Z"},"links":{"cited_paper":"/paper/2304.08477","citing_paper":"/paper/2412.06029"},"observation_digest":"sha256:4caca211fffc2eb35711b6d25612471c82d866bf8dda7645bd96700b0010ec07","observation_id":"812eee19-68e4-4feb-8a99-6071cc6a5fe4","resolution":{"observed_at":"2026-08-11T20:09:26.059474Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2410.21273","last_updated":"2024-10-28T17:59:13Z","snapshot_observed_at":"2026-08-12T22:13:33.101211Z","submitted_at":"2024-10-28T17:59:13Z","title":"On Inductive Biases That Enable Generalization of Diffusion Transformers","version":1},"cited_work":{"arxiv_id":"2410.21273","doi":null,"metadata_source":"pith","pith_arxiv_id":"2410.21273","snapshot_observed_at":"2026-08-11T20:09:26.354899Z","title":"On Inductive Biases That Enable Generalization of Diffusion Transformers","venue":"cs.CV","work_id":"24286925-5abc-4b8f-a8b8-276e1ad0153c","year":2024},"citing_paper":{"arxiv_id":"2412.06029","last_updated":"2024-12-08T18:59:54Z","snapshot_observed_at":"2026-08-13T13:48:07.666011Z","submitted_at":"2024-12-08T18:59:54Z","title":"Latent-Reframe: Enabling Camera Control for Video Diffusion Model without Training","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-11T20:09:26.063162Z"},"links":{"cited_paper":"/paper/2410.21273","citing_paper":"/paper/2412.06029"},"observation_digest":"sha256:dd2fe49635ef3beb5a5d4f52ea89af9dd2727f8974baecdf861c4b09ad69cdd1","observation_id":"dd749c36-164b-4e96-9c29-5e6d88b7bfe9","resolution":{"observed_at":"2026-08-11T20:09:26.359815Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2401.02414","last_updated":"2024-01-04T18:55:01Z","snapshot_observed_at":"2026-08-13T04:48:51.156960Z","submitted_at":"2024-01-04T18:55:01Z","title":"Bring Metric Functions into Diffusion Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2401.02414","snapshot_observed_at":"2026-08-11T20:09:26.065841Z","title":"Bring metric functions into diffusion models","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2412.06029","last_updated":"2024-12-08T18:59:54Z","snapshot_observed_at":"2026-08-13T13:48:07.666011Z","submitted_at":"2024-12-08T18:59:54Z","title":"Latent-Reframe: Enabling Camera Control for Video Diffusion Model without Training","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-11T20:09:26.065841Z"},"links":{"cited_paper":"/paper/2401.02414","citing_paper":"/paper/2412.06029"},"observation_digest":"sha256:014d931b11b649e375c446d0da2f48191ad3c66b90a657fa29d714a92dcdcf6b","observation_id":"a608900b-f220-4e3f-827e-e57222279721","resolution":{"observed_at":"2026-08-11T20:09:26.065841Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T20:09:26.590457Z","title":"Align your latents: High-Resolution Video Synthesis with Latent Diffusion Models","venue":null,"work_id":"2c5b259e-ab33-48c4-9617-76c5eb06d0be","year":2023},"citing_paper":{"arxiv_id":"2412.06029","last_updated":"2024-12-08T18:59:54Z","snapshot_observed_at":"2026-08-13T13:48:07.666011Z","submitted_at":"2024-12-08T18:59:54Z","title":"Latent-Reframe: Enabling Camera Control for Video Diffusion Model without Training","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-11T20:09:26.069636Z"},"links":{"citing_paper":"/paper/2412.06029"},"observation_digest":"sha256:ab105525755d914ac924a630a02a0404ea535451c3fb29a8c04d9776d3fdbfe4","observation_id":"048624cc-8ad7-406f-9e6d-7029b903d33e","resolution":{"observed_at":"2026-08-11T20:09:26.593867Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2310.19512","last_updated":"2023-10-30T13:12:40Z","snapshot_observed_at":"2026-08-13T01:39:12.659510Z","submitted_at":"2023-10-30T13:12:40Z","title":"VideoCrafter1: Open Diffusion Models for High-Quality Video Generation","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2310.19512","snapshot_observed_at":"2026-08-11T20:09:26.072386Z","title":"VideoCrafter1: Open Dif- fusion Models for High-Quality Video Generation","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2412.06029","last_updated":"2024-12-08T18:59:54Z","snapshot_observed_at":"2026-08-13T13:48:07.666011Z","submitted_at":"2024-12-08T18:59:54Z","title":"Latent-Reframe: Enabling Camera Control for Video Diffusion Model without Training","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-11T20:09:26.072386Z"},"links":{"cited_paper":"/paper/2310.19512","citing_paper":"/paper/2412.06029"},"observation_digest":"sha256:05ed2846f180170242fcbbdd8c59168acb81c7a5ca8b26e5ebcfc3a26122e2b4","observation_id":"134d1a11-ff1d-4aad-ab6d-d9e231fba72f","resolution":{"observed_at":"2026-08-11T20:09:26.072386Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2401.09047","last_updated":"2024-01-17T08:30:32Z","snapshot_observed_at":"2026-08-13T04:40:49.704758Z","submitted_at":"2024-01-17T08:30:32Z","title":"VideoCrafter2: Overcoming Data Limitations for High-Quality Video Diffusion Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2401.09047","snapshot_observed_at":"2026-08-11T20:09:26.076081Z","title":"VideoCrafter2: Overcoming Data Limitations for High-Quality Video Diffu- sion Models","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2412.06029","last_updated":"2024-12-08T18:59:54Z","snapshot_observed_at":"2026-08-13T13:48:07.666011Z","submitted_at":"2024-12-08T18:59:54Z","title":"Latent-Reframe: Enabling Camera Control for Video Diffusion Model without Training","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-11T20:09:26.076081Z"},"links":{"cited_paper":"/paper/2401.09047","citing_paper":"/paper/2412.06029"},"observation_digest":"sha256:6741a72965b3769d32dd85d8c21d0d44f81de9eab3fa963e8307d644288d7f64","observation_id":"ba12f3e2-9e05-44c5-9b51-004e8cca5fd4","resolution":{"observed_at":"2026-08-11T20:09:26.076081Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T20:09:26.079596Z","title":"Instantsplat: Unbounded sparse-view pose-free gaus- sian splatting in 40 seconds, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2412.06029","last_updated":"2024-12-08T18:59:54Z","snapshot_observed_at":"2026-08-13T13:48:07.666011Z","submitted_at":"2024-12-08T18:59:54Z","title":"Latent-Reframe: Enabling Camera Control for Video Diffusion Model without Training","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-11T20:09:26.079596Z"},"links":{"citing_paper":"/paper/2412.06029"},"observation_digest":"sha256:017d5f071e0cdd30001a77f6327d39111a2d5cef7df76cf80f8171aaddbfc275","observation_id":"3f352b9e-2658-44f9-b929-f5ef04db577b","resolution":{"observed_at":"2026-08-11T20:09:26.079596Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T20:09:26.082918Z","title":"Preserve Your Own Correlation: A Noise Prior for Video Diffusion Models","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2412.06029","last_updated":"2024-12-08T18:59:54Z","snapshot_observed_at":"2026-08-13T13:48:07.666011Z","submitted_at":"2024-12-08T18:59:54Z","title":"Latent-Reframe: Enabling Camera Control for Video Diffusion Model without Training","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-11T20:09:26.082918Z"},"links":{"citing_paper":"/paper/2412.06029"},"observation_digest":"sha256:bfad1d0d86388e07084914e654aaeb0443c526e1c77cf15d8dd17c50effe40a2","observation_id":"95218c3e-97bf-4226-b960-3279becab947","resolution":{"observed_at":"2026-08-11T20:09:26.082918Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T20:09:26.574171Z","title":"Animatediff: Animate your personalized text-to- image diffusion models without specific tuning","venue":null,"work_id":"e2b4dd85-a1da-4245-9c7d-cc8a24053609","year":2024},"citing_paper":{"arxiv_id":"2412.06029","last_updated":"2024-12-08T18:59:54Z","snapshot_observed_at":"2026-08-13T13:48:07.666011Z","submitted_at":"2024-12-08T18:59:54Z","title":"Latent-Reframe: Enabling Camera Control for Video Diffusion Model without Training","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-11T20:09:26.085746Z"},"links":{"citing_paper":"/paper/2412.06029"},"observation_digest":"sha256:236320a036d3b9b6e6fe7b9a855671254260fbb7e56351efd190b2c817e6ddb0","observation_id":"60684632-ef57-4819-be1d-ab91ec906ca3","resolution":{"observed_at":"2026-08-11T20:09:26.576861Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T20:09:26.565507Z","title":"AnimateDiff: Animate Your Personalized Text-to- Image Diffusion Models without Specific Tuning","venue":null,"work_id":"e9de6651-280f-4870-8425-8890b1e1c427","year":null},"citing_paper":{"arxiv_id":"2412.06029","last_updated":"2024-12-08T18:59:54Z","snapshot_observed_at":"2026-08-13T13:48:07.666011Z","submitted_at":"2024-12-08T18:59:54Z","title":"Latent-Reframe: Enabling Camera Control for Video Diffusion Model without Training","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-11T20:09:26.088637Z"},"links":{"citing_paper":"/paper/2412.06029"},"observation_digest":"sha256:dfe29c51cabbe738639725b249ff691ce402d48ea45641288cda8ee8b2247fb5","observation_id":"f43224c7-286e-4da2-b8c0-9fff15ca40f4","resolution":{"observed_at":"2026-08-11T20:09:26.568351Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2404.02101","last_updated":"2025-03-13T18:35:06Z","snapshot_observed_at":"2026-08-12T01:27:32.593496Z","submitted_at":"2024-04-02T16:52:41Z","title":"CameraCtrl: Enabling Camera Control for Text-to-Video Generation","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2404.02101","snapshot_observed_at":"2026-08-11T20:09:26.091643Z","title":"Cameractrl: Enabling camera control for text-to-video generation","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2412.06029","last_updated":"2024-12-08T18:59:54Z","snapshot_observed_at":"2026-08-13T13:48:07.666011Z","submitted_at":"2024-12-08T18:59:54Z","title":"Latent-Reframe: Enabling Camera Control for Video Diffusion Model without Training","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-11T20:09:26.091643Z"},"links":{"cited_paper":"/paper/2404.02101","citing_paper":"/paper/2412.06029"},"observation_digest":"sha256:eaaf1d6cd19a9f70340d8de463d0aa09c1ea9bc015088a46a6f6fcad9fd9eeb3","observation_id":"21b7cc7e-85d0-44f0-9ed7-e5e111cb3b73","resolution":{"observed_at":"2026-08-11T20:09:26.091643Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T20:09:26.555905Z","title":"Gans trained by a two time-scale update rule converge to a local nash equilib- rium","venue":null,"work_id":"9e9075c3-a52a-4715-811d-483d6f3e6366","year":2017},"citing_paper":{"arxiv_id":"2412.06029","last_updated":"2024-12-08T18:59:54Z","snapshot_observed_at":"2026-08-13T13:48:07.666011Z","submitted_at":"2024-12-08T18:59:54Z","title":"Latent-Reframe: Enabling Camera Control for Video Diffusion Model without Training","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-11T20:09:26.095407Z"},"links":{"citing_paper":"/paper/2412.06029"},"observation_digest":"sha256:ca7d651b8cc0a1ab204dbf7b690899a552802c776b8dfc6510f04768ac77e3bc","observation_id":"fbde206d-4b82-434c-97bd-2d197a97d0fa","resolution":{"observed_at":"2026-08-11T20:09:26.559823Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T20:09:26.098449Z","title":"Denoising dif- fusion probabilistic models","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2412.06029","last_updated":"2024-12-08T18:59:54Z","snapshot_observed_at":"2026-08-13T13:48:07.666011Z","submitted_at":"2024-12-08T18:59:54Z","title":"Latent-Reframe: Enabling Camera Control for Video Diffusion Model without Training","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-11T20:09:26.098449Z"},"links":{"citing_paper":"/paper/2412.06029"},"observation_digest":"sha256:cd8b18156ba9e3dab7859d2b17daa55553610f849761494da53fa04b27736652","observation_id":"a5881420-f2fe-4079-b2e5-33f74b80ea54","resolution":{"observed_at":"2026-08-11T20:09:26.098449Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2210.02303","last_updated":"2022-10-05T14:41:38Z","snapshot_observed_at":"2026-07-06T13:59:57.800591Z","submitted_at":"2022-10-05T14:41:38Z","title":"Imagen Video: High Definition Video Generation with Diffusion Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2210.02303","snapshot_observed_at":"2026-08-11T20:09:26.100856Z","title":"Imagen Video: High Definition Video Generation with Diffusion Models","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2412.06029","last_updated":"2024-12-08T18:59:54Z","snapshot_observed_at":"2026-08-13T13:48:07.666011Z","submitted_at":"2024-12-08T18:59:54Z","title":"Latent-Reframe: Enabling Camera Control for Video Diffusion Model without Training","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-11T20:09:26.100856Z"},"links":{"cited_paper":"/paper/2210.02303","citing_paper":"/paper/2412.06029"},"observation_digest":"sha256:1001fe674ffe835c9de2b5aa10f2621d96c36aeed999288444b4c4d0bbd1f473","observation_id":"b3974b29-d660-4819-bdba-ed28a7cf8762","resolution":{"observed_at":"2026-08-11T20:09:26.100856Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T20:09:26.543515Z","title":"Video Diffu- sion Models","venue":null,"work_id":"dc745ece-1dab-45b5-ab6f-f4d80f4fed82","year":2022},"citing_paper":{"arxiv_id":"2412.06029","last_updated":"2024-12-08T18:59:54Z","snapshot_observed_at":"2026-08-13T13:48:07.666011Z","submitted_at":"2024-12-08T18:59:54Z","title":"Latent-Reframe: Enabling Camera Control for Video Diffusion Model without Training","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-11T20:09:26.104192Z"},"links":{"citing_paper":"/paper/2412.06029"},"observation_digest":"sha256:25d867e6f96adba3bacff22c2525d0a9fbff4655211990a0ac95a9ce7ca891ab","observation_id":"555a93fc-fbeb-457d-8a6d-dfec23ab2704","resolution":{"observed_at":"2026-08-11T20:09:26.546753Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2406.10126","last_updated":"2025-02-25T00:32:29Z","snapshot_observed_at":"2026-08-13T14:03:38.366155Z","submitted_at":"2024-06-14T15:33:00Z","title":"Training-free Camera Control for Video Generation","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2406.10126","snapshot_observed_at":"2026-08-11T20:09:26.107083Z","title":"Training-free camera control for video generation","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2412.06029","last_updated":"2024-12-08T18:59:54Z","snapshot_observed_at":"2026-08-13T13:48:07.666011Z","submitted_at":"2024-12-08T18:59:54Z","title":"Latent-Reframe: Enabling Camera Control for Video Diffusion Model without Training","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-11T20:09:26.107083Z"},"links":{"cited_paper":"/paper/2406.10126","citing_paper":"/paper/2412.06029"},"observation_digest":"sha256:b77ad934e452efc4b1e96e39a347886237ba01d04af27da0c8de3428abd0f510","observation_id":"225a167a-0256-453c-80e2-1ce6740ac057","resolution":{"observed_at":"2026-08-11T20:09:26.107083Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2106.09685","last_updated":"2021-10-16T18:40:34Z","snapshot_observed_at":"2026-08-11T08:20:29.798517Z","submitted_at":"2021-06-17T17:37:18Z","title":"LoRA: Low-Rank Adaptation of Large Language Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2106.09685","snapshot_observed_at":"2026-08-11T20:09:26.110601Z","title":"Lora: Low-rank adaptation of large language models","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2412.06029","last_updated":"2024-12-08T18:59:54Z","snapshot_observed_at":"2026-08-13T13:48:07.666011Z","submitted_at":"2024-12-08T18:59:54Z","title":"Latent-Reframe: Enabling Camera Control for Video Diffusion Model without Training","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-11T20:09:26.110601Z"},"links":{"cited_paper":"/paper/2106.09685","citing_paper":"/paper/2412.06029"},"observation_digest":"sha256:f649847059555763e9b0cd8dbc0febfef0fc6340093e1dedbca66b0b6ff613d5","observation_id":"0e2c8c91-5007-4f00-9b6e-c3c4bd05b59d","resolution":{"observed_at":"2026-08-11T20:09:26.110601Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2007.13640","last_updated":"2021-05-07T02:34:03Z","snapshot_observed_at":"2026-08-08T12:31:55.574538Z","submitted_at":"2020-07-27T15:40:46Z","title":"Solving Linear Inverse Problems Using the Prior Implicit in a Denoiser","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2007.13640","snapshot_observed_at":"2026-08-11T20:09:26.113046Z","title":"Solving linear inverse problems using the prior implicit in a denoiser.arXiv preprint arXiv:2007.13640, 2020","venue":null,"work_id":null,"year":2007},"citing_paper":{"arxiv_id":"2412.06029","last_updated":"2024-12-08T18:59:54Z","snapshot_observed_at":"2026-08-13T13:48:07.666011Z","submitted_at":"2024-12-08T18:59:54Z","title":"Latent-Reframe: Enabling Camera Control for Video Diffusion Model without Training","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-11T20:09:26.113046Z"},"links":{"cited_paper":"/paper/2007.13640","citing_paper":"/paper/2412.06029"},"observation_digest":"sha256:952d43809f5fc09f68a853e04c2f0bd5f0ed90d0f48771e211a2334178b217f8","observation_id":"5cc081ed-7fa9-453c-a603-b87878b6f061","resolution":{"observed_at":"2026-08-11T20:09:26.113046Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T20:09:26.116001Z","title":"3d gaussian splatting for real-time radiance field rendering","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2412.06029","last_updated":"2024-12-08T18:59:54Z","snapshot_observed_at":"2026-08-13T13:48:07.666011Z","submitted_at":"2024-12-08T18:59:54Z","title":"Latent-Reframe: Enabling Camera Control for Video Diffusion Model without Training","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-11T20:09:26.116001Z"},"links":{"citing_paper":"/paper/2412.06029"},"observation_digest":"sha256:1edfa0a9c53fcba3bec2787a640f3642d7ccf8f76129cb880e48a3e3ece6a65f","observation_id":"cc0c6c35-d0c3-4433-95c5-e4f45322ce43","resolution":{"observed_at":"2026-08-11T20:09:26.116001Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T20:09:26.532371Z","title":"Fifo-diffusion: Generating infinite videos from text without training","venue":null,"work_id":"b0b1bc76-54da-43be-853e-34a81fc0b69d","year":2024},"citing_paper":{"arxiv_id":"2412.06029","last_updated":"2024-12-08T18:59:54Z","snapshot_observed_at":"2026-08-13T13:48:07.666011Z","submitted_at":"2024-12-08T18:59:54Z","title":"Latent-Reframe: Enabling Camera Control for Video Diffusion Model without Training","version":1},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-11T20:09:26.118703Z"},"links":{"citing_paper":"/paper/2412.06029"},"observation_digest":"sha256:e7268af8e32e16392a2030035ebf9dc4aa22e29e59863d85d1562b8c420c56e6","observation_id":"5a61912f-53df-4acf-bb45-68fdeff89234","resolution":{"observed_at":"2026-08-11T20:09:26.535424Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T20:09:26.524601Z","title":"Ground- ing image matching in 3d with mast3r, 2024","venue":null,"work_id":"4707bb2e-502a-449c-ab64-fb366945dc6f","year":2024},"citing_paper":{"arxiv_id":"2412.06029","last_updated":"2024-12-08T18:59:54Z","snapshot_observed_at":"2026-08-13T13:48:07.666011Z","submitted_at":"2024-12-08T18:59:54Z","title":"Latent-Reframe: Enabling Camera Control for Video Diffusion Model without Training","version":1},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-11T20:09:26.120729Z"},"links":{"citing_paper":"/paper/2412.06029"},"observation_digest":"sha256:d97f9c71006fa90172704bec88108a72bc2f62a0e5b00ec5473bbb7647e381dd","observation_id":"d0c2f7c2-8f9d-4a9a-b5c9-752b71b894f2","resolution":{"observed_at":"2026-08-11T20:09:26.527976Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T20:09:26.517774Z","title":"Re- conx: Reconstruct any scene from sparse views with video diffusion model, 2024","venue":null,"work_id":"a367be18-3261-4841-8f4d-d7666ee099d3","year":2024},"citing_paper":{"arxiv_id":"2412.06029","last_updated":"2024-12-08T18:59:54Z","snapshot_observed_at":"2026-08-13T13:48:07.666011Z","submitted_at":"2024-12-08T18:59:54Z","title":"Latent-Reframe: Enabling Camera Control for Video Diffusion Model without Training","version":1},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-11T20:09:26.122615Z"},"links":{"citing_paper":"/paper/2412.06029"},"observation_digest":"sha256:e06626b8e7d8dfd047b62ef515039d8b998b6e8ae1d87d7b1cf46593d529be41","observation_id":"eefe9455-2d78-4554-af60-1c3f56fea41b","resolution":{"observed_at":"2026-08-11T20:09:26.519923Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T20:09:26.510557Z","title":"Repaint: Inpainting using denoising diffusion probabilistic models","venue":null,"work_id":"44c1a240-2748-4305-95da-51db6b15cdc7","year":2022},"citing_paper":{"arxiv_id":"2412.06029","last_updated":"2024-12-08T18:59:54Z","snapshot_observed_at":"2026-08-13T13:48:07.666011Z","submitted_at":"2024-12-08T18:59:54Z","title":"Latent-Reframe: Enabling Camera Control for Video Diffusion Model without Training","version":1},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-11T20:09:26.124480Z"},"links":{"citing_paper":"/paper/2412.06029"},"observation_digest":"sha256:170bbe347515c58d2940f9ae5030885496525f8ad0312309f83e0fa69d3baaef","observation_id":"e3e75ca5-70ce-4f5b-a42c-68eddb1187c0","resolution":{"observed_at":"2026-08-11T20:09:26.513442Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T20:09:26.127144Z","title":"Srinivasan, Matthew Tancik, Jonathan T","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2412.06029","last_updated":"2024-12-08T18:59:54Z","snapshot_observed_at":"2026-08-13T13:48:07.666011Z","submitted_at":"2024-12-08T18:59:54Z","title":"Latent-Reframe: Enabling Camera Control for Video Diffusion Model without Training","version":1},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-11T20:09:26.127144Z"},"links":{"citing_paper":"/paper/2412.06029"},"observation_digest":"sha256:23dd8663c17c429d6fa9afc2fb5d620c7d3dbe30bb8aaaf34cfc9b76b2932202","observation_id":"cb6b4f51-dc86-41c7-8115-f263766fe271","resolution":{"observed_at":"2026-08-11T20:09:26.127144Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T20:09:26.129755Z","title":"Improved denoising diffusion probabilistic models","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2412.06029","last_updated":"2024-12-08T18:59:54Z","snapshot_observed_at":"2026-08-13T13:48:07.666011Z","submitted_at":"2024-12-08T18:59:54Z","title":"Latent-Reframe: Enabling Camera Control for Video Diffusion Model without Training","version":1},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-08-11T20:09:26.129755Z"},"links":{"citing_paper":"/paper/2412.06029"},"observation_digest":"sha256:7d26d64a878436fd36c9981b1f06e58e926cc296352383bb0ca5b79213374565","observation_id":"92a1db0b-14e9-4e8b-9e67-735d6f378de5","resolution":{"observed_at":"2026-08-11T20:09:26.129755Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T20:09:26.131900Z","title":"Scalable diffusion models with transformers","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2412.06029","last_updated":"2024-12-08T18:59:54Z","snapshot_observed_at":"2026-08-13T13:48:07.666011Z","submitted_at":"2024-12-08T18:59:54Z","title":"Latent-Reframe: Enabling Camera Control for Video Diffusion Model without Training","version":1},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-08-11T20:09:26.131900Z"},"links":{"citing_paper":"/paper/2412.06029"},"observation_digest":"sha256:62a42feba33161037b1f6a8a0a1425082d1a079973b95d17d1aa775554653eda","observation_id":"6cb675ce-d5fe-4ee3-8260-719895cedfa1","resolution":{"observed_at":"2026-08-11T20:09:26.131900Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2007.08501","last_updated":"2020-07-16T17:53:02Z","snapshot_observed_at":"2026-07-06T09:38:53.228850Z","submitted_at":"2020-07-16T17:53:02Z","title":"Accelerating 3D Deep Learning with PyTorch3D","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2007.08501","snapshot_observed_at":"2026-08-11T20:09:26.134277Z","title":"Accelerating 3d deep learning with pytorch3d","venue":null,"work_id":null,"year":2007},"citing_paper":{"arxiv_id":"2412.06029","last_updated":"2024-12-08T18:59:54Z","snapshot_observed_at":"2026-08-13T13:48:07.666011Z","submitted_at":"2024-12-08T18:59:54Z","title":"Latent-Reframe: Enabling Camera Control for Video Diffusion Model without Training","version":1},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-08-11T20:09:26.134277Z"},"links":{"cited_paper":"/paper/2007.08501","citing_paper":"/paper/2412.06029"},"observation_digest":"sha256:1a65742077d50bf49d7a5f42399dac7a4ef118eb7842bfff5304baae9148d921","observation_id":"f72b536e-3171-4599-ab0e-b9d4c29d858c","resolution":{"observed_at":"2026-08-11T20:09:26.134277Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T20:09:26.490813Z","title":"U-net: Convolutional networks for biomedical image segmentation","venue":null,"work_id":"12c62ccd-877d-477e-9f6f-14c07be182c0","year":2015},"citing_paper":{"arxiv_id":"2412.06029","last_updated":"2024-12-08T18:59:54Z","snapshot_observed_at":"2026-08-13T13:48:07.666011Z","submitted_at":"2024-12-08T18:59:54Z","title":"Latent-Reframe: Enabling Camera Control for Video Diffusion Model without Training","version":1},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-08-11T20:09:26.138103Z"},"links":{"citing_paper":"/paper/2412.06029"},"observation_digest":"sha256:5a7131fd4592068514a8a098598a12ded83007d2024fb27d912e94fbe7cf28bc","observation_id":"0aeb3646-7e2c-4b3e-aee5-70cf8e95e082","resolution":{"observed_at":"2026-08-11T20:09:26.494012Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T20:09:26.482610Z","title":"Dragdiffusion: Harnessing diffusion models for interactive point-based image editing","venue":null,"work_id":"996da594-09a9-45ac-a206-6f43ea5b1b7a","year":2024},"citing_paper":{"arxiv_id":"2412.06029","last_updated":"2024-12-08T18:59:54Z","snapshot_observed_at":"2026-08-13T13:48:07.666011Z","submitted_at":"2024-12-08T18:59:54Z","title":"Latent-Reframe: Enabling Camera Control for Video Diffusion Model without Training","version":1},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-08-11T20:09:26.141422Z"},"links":{"citing_paper":"/paper/2412.06029"},"observation_digest":"sha256:df5fe800b2a1f26fa8a8013c3fb8288b4d4002a1300a1f10642c11d842f8978b","observation_id":"eb6aaded-c9a7-4cea-bcb3-a65e66330b43","resolution":{"observed_at":"2026-08-11T20:09:26.486480Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T20:09:26.474338Z","title":"Make-A-Video: Text-to-Video Generation without Text-Video Data","venue":null,"work_id":"6bd31c1d-b1e9-4055-aaaa-c6e02b20c1f8","year":2023},"citing_paper":{"arxiv_id":"2412.06029","last_updated":"2024-12-08T18:59:54Z","snapshot_observed_at":"2026-08-13T13:48:07.666011Z","submitted_at":"2024-12-08T18:59:54Z","title":"Latent-Reframe: Enabling Camera Control for Video Diffusion Model without Training","version":1},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-08-11T20:09:26.144101Z"},"links":{"citing_paper":"/paper/2412.06029"},"observation_digest":"sha256:61fb48b947e935c89cf6a1a1cc9d839480129e482126c729156d9009f6fd29f9","observation_id":"24d1f096-4339-479d-acef-ab702819c9b9","resolution":{"observed_at":"2026-08-11T20:09:26.477195Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2408.13912","last_updated":"2024-08-27T19:06:57Z","snapshot_observed_at":"2026-08-05T11:12:55.434512Z","submitted_at":"2024-08-25T18:27:20Z","title":"Splatt3R: Zero-shot Gaussian Splatting from Uncalibrated Image Pairs","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2408.13912","snapshot_observed_at":"2026-08-11T20:09:26.146544Z","title":"Splatt3r: Zero-shot gaussian splatting from uncalibrated image pairs","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2412.06029","last_updated":"2024-12-08T18:59:54Z","snapshot_observed_at":"2026-08-13T13:48:07.666011Z","submitted_at":"2024-12-08T18:59:54Z","title":"Latent-Reframe: Enabling Camera Control for Video Diffusion Model without Training","version":1},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-08-11T20:09:26.146544Z"},"links":{"cited_paper":"/paper/2408.13912","citing_paper":"/paper/2412.06029"},"observation_digest":"sha256:bc8dd11a0f96758650e5e79b72c1ffb51cf336c46ca9eb4d5388ba6aeec3e2a2","observation_id":"53a27d15-ca11-41a4-8eae-72eabb4ef455","resolution":{"observed_at":"2026-08-11T20:09:26.146544Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T20:09:26.149774Z","title":"Deep unsupervised learning using nonequilibrium thermodynamics","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2412.06029","last_updated":"2024-12-08T18:59:54Z","snapshot_observed_at":"2026-08-13T13:48:07.666011Z","submitted_at":"2024-12-08T18:59:54Z","title":"Latent-Reframe: Enabling Camera Control for Video Diffusion Model without Training","version":1},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-08-11T20:09:26.149774Z"},"links":{"citing_paper":"/paper/2412.06029"},"observation_digest":"sha256:a1ff6ef553adf25020bd7e77f34e47612582d64c396120edafd73cb7a4599240","observation_id":"2ec0f422-616f-4b5b-91e8-9ccd9631c7e3","resolution":{"observed_at":"2026-08-11T20:09:26.149774Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2010.02502","last_updated":"2022-10-05T20:19:21Z","snapshot_observed_at":"2026-08-11T15:38:14.931716Z","submitted_at":"2020-10-06T06:15:51Z","title":"Denoising Diffusion Implicit Models","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2010.02502","snapshot_observed_at":"2026-08-11T20:09:26.152603Z","title":"Denoising diffusion implicit models","venue":null,"work_id":null,"year":2010},"citing_paper":{"arxiv_id":"2412.06029","last_updated":"2024-12-08T18:59:54Z","snapshot_observed_at":"2026-08-13T13:48:07.666011Z","submitted_at":"2024-12-08T18:59:54Z","title":"Latent-Reframe: Enabling Camera Control for Video Diffusion Model without Training","version":1},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-08-11T20:09:26.152603Z"},"links":{"cited_paper":"/paper/2010.02502","citing_paper":"/paper/2412.06029"},"observation_digest":"sha256:7bd76af01315b1e90e91074432603c227143ae4ab82cb9de26c65ee37edb4e65","observation_id":"00b0058a-7bf1-482e-9680-622cf9348f5a","resolution":{"observed_at":"2026-08-11T20:09:26.152603Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2011.13456","last_updated":"2021-02-10T18:17:04Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2020-11-26T19:39:10Z","title":"Score-Based Generative Modeling through Stochastic Differential Equations","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2011.13456","snapshot_observed_at":"2026-08-11T20:09:26.155309Z","title":"Score-based generative modeling through stochastic differential equa- tions","venue":null,"work_id":null,"year":2011},"citing_paper":{"arxiv_id":"2412.06029","last_updated":"2024-12-08T18:59:54Z","snapshot_observed_at":"2026-08-13T13:48:07.666011Z","submitted_at":"2024-12-08T18:59:54Z","title":"Latent-Reframe: Enabling Camera Control for Video Diffusion Model without Training","version":1},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-08-11T20:09:26.155309Z"},"links":{"cited_paper":"/paper/2011.13456","citing_paper":"/paper/2412.06029"},"observation_digest":"sha256:f8117ff1e2ca6e926aff48cb3009dc92f0f4623395e1c31cb2b2be13cadc1b2b","observation_id":"152fe9ef-0338-4c97-b18b-b022e92f040c","resolution":{"observed_at":"2026-08-11T20:09:26.155309Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1812.01717","last_updated":"2019-03-27T16:43:17Z","snapshot_observed_at":"2026-08-11T02:30:38.877941Z","submitted_at":"2018-12-03T03:57:42Z","title":"Towards Accurate Generative Models of Video: A New Metric & Challenges","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1812.01717","snapshot_observed_at":"2026-08-11T20:09:26.158396Z","title":"To- wards accurate generative models of video: A new metric & challenges","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2412.06029","last_updated":"2024-12-08T18:59:54Z","snapshot_observed_at":"2026-08-13T13:48:07.666011Z","submitted_at":"2024-12-08T18:59:54Z","title":"Latent-Reframe: Enabling Camera Control for Video Diffusion Model without Training","version":1},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-08-11T20:09:26.158396Z"},"links":{"cited_paper":"/paper/1812.01717","citing_paper":"/paper/2412.06029"},"observation_digest":"sha256:4048317b2f318ed3c160fac510eb63a217cfa61566336d741a21839bf68092f5","observation_id":"ec924fe2-73c1-4ef0-bc97-34fd4b38899d","resolution":{"observed_at":"2026-08-11T20:09:26.158396Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T20:09:26.462979Z","title":"Phenaki: Variable Length Video Generation from Open Do- main Textual Description","venue":null,"work_id":"cc9ed1b4-977b-4d73-9b11-c3d7025940bc","year":2023},"citing_paper":{"arxiv_id":"2412.06029","last_updated":"2024-12-08T18:59:54Z","snapshot_observed_at":"2026-08-13T13:48:07.666011Z","submitted_at":"2024-12-08T18:59:54Z","title":"Latent-Reframe: Enabling Camera Control for Video Diffusion Model without Training","version":1},"reference_index":36,"source":"pdf_text","source_observed_at":"2026-08-11T20:09:26.162019Z"},"links":{"citing_paper":"/paper/2412.06029"},"observation_digest":"sha256:874b7efa14832aaf3f7610290c279c9aa14cf3380e5caa6ad99112ccd45946e6","observation_id":"18e8b20e-f38d-473a-9b96-31a6a1a44cca","resolution":{"observed_at":"2026-08-11T20:09:26.466062Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T20:09:26.454333Z","title":"MCVD-Masked Conditional Video Diffusion for Pre- diction, Generation, and Interpolation","venue":null,"work_id":"bb513084-d994-4ba6-b6da-e7956662bcea","year":2022},"citing_paper":{"arxiv_id":"2412.06029","last_updated":"2024-12-08T18:59:54Z","snapshot_observed_at":"2026-08-13T13:48:07.666011Z","submitted_at":"2024-12-08T18:59:54Z","title":"Latent-Reframe: Enabling Camera Control for Video Diffusion Model without Training","version":1},"reference_index":37,"source":"pdf_text","source_observed_at":"2026-08-11T20:09:26.164841Z"},"links":{"citing_paper":"/paper/2412.06029"},"observation_digest":"sha256:eb3a72f0a0e74a89346b4aa123b3189b69ab462c4a54d5d55d2508fd084db061","observation_id":"356554c1-71d8-44d6-b411-2678b8681ca5","resolution":{"observed_at":"2026-08-11T20:09:26.457433Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T20:09:26.445971Z","title":"Dust3r: Geometric 3d vi- sion made easy","venue":null,"work_id":"40fc00c6-d29f-489f-8f35-d16c61e66f44","year":2024},"citing_paper":{"arxiv_id":"2412.06029","last_updated":"2024-12-08T18:59:54Z","snapshot_observed_at":"2026-08-13T13:48:07.666011Z","submitted_at":"2024-12-08T18:59:54Z","title":"Latent-Reframe: Enabling Camera Control for Video Diffusion Model without Training","version":1},"reference_index":38,"source":"pdf_text","source_observed_at":"2026-08-11T20:09:26.167720Z"},"links":{"citing_paper":"/paper/2412.06029"},"observation_digest":"sha256:3e89a1d233aa07588a82baa0f5bee1107846f70f41842f3a9ffce4d4bb509795","observation_id":"0a8dfdf0-cba8-4dfc-9a98-6f7f74f4c223","resolution":{"observed_at":"2026-08-11T20:09:26.448953Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T20:09:26.437487Z","title":"VideoComposer: Compositional Video Synthesis with Motion Controllability","venue":null,"work_id":"d82b48bf-e86c-42ef-9e60-1e9f932a326b","year":2023},"citing_paper":{"arxiv_id":"2412.06029","last_updated":"2024-12-08T18:59:54Z","snapshot_observed_at":"2026-08-13T13:48:07.666011Z","submitted_at":"2024-12-08T18:59:54Z","title":"Latent-Reframe: Enabling Camera Control for Video Diffusion Model without Training","version":1},"reference_index":39,"source":"pdf_text","source_observed_at":"2026-08-11T20:09:26.170951Z"},"links":{"citing_paper":"/paper/2412.06029"},"observation_digest":"sha256:40de272c2a84017d70c766651df9ab8640d2252f8bb6a5cfcf61a604e2b1d74c","observation_id":"939a4f95-f6ed-424b-abd9-082d3cf96539","resolution":{"observed_at":"2026-08-11T20:09:26.441108Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T20:09:26.429709Z","title":"Motionctrl: A unified and flexible motion controller for video generation","venue":null,"work_id":"3eb5d56a-a4b1-4fca-be3f-b3bf5bdfd0e5","year":2024},"citing_paper":{"arxiv_id":"2412.06029","last_updated":"2024-12-08T18:59:54Z","snapshot_observed_at":"2026-08-13T13:48:07.666011Z","submitted_at":"2024-12-08T18:59:54Z","title":"Latent-Reframe: Enabling Camera Control for Video Diffusion Model without Training","version":1},"reference_index":40,"source":"pdf_text","source_observed_at":"2026-08-11T20:09:26.173336Z"},"links":{"citing_paper":"/paper/2412.06029"},"observation_digest":"sha256:20902e4f6839706622b88a521f24e4de4e7b1998165def552e674bd8bc5a7257","observation_id":"550446b2-3e6b-4da4-ac66-8e473776fc9e","resolution":{"observed_at":"2026-08-11T20:09:26.432430Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T20:09:26.422814Z","title":"Tune-A-Video: One-Shot Tuning of Image Diffusion Models for Text-to-Video Generation","venue":null,"work_id":"83778d9d-d9a4-41ea-b97a-6eaa3b09997a","year":2023},"citing_paper":{"arxiv_id":"2412.06029","last_updated":"2024-12-08T18:59:54Z","snapshot_observed_at":"2026-08-13T13:48:07.666011Z","submitted_at":"2024-12-08T18:59:54Z","title":"Latent-Reframe: Enabling Camera Control for Video Diffusion Model without Training","version":1},"reference_index":41,"source":"pdf_text","source_observed_at":"2026-08-11T20:09:26.175702Z"},"links":{"citing_paper":"/paper/2412.06029"},"observation_digest":"sha256:a76ad97ec782d41c722bd6d9d05a4afa4539f318df8f13e0610b21a94d0ce714","observation_id":"85e2739c-649f-432c-b1fa-744cd63f0157","resolution":{"observed_at":"2026-08-11T20:09:26.425544Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2406.02509","last_updated":"2024-06-04T17:27:19Z","snapshot_observed_at":"2026-08-04T13:02:12.217544Z","submitted_at":"2024-06-04T17:27:19Z","title":"CamCo: Camera-Controllable 3D-Consistent Image-to-Video Generation","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2406.02509","snapshot_observed_at":"2026-08-11T20:09:26.178025Z","title":"Camco: Camera- controllable 3d-consistent image-to-video generation","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2412.06029","last_updated":"2024-12-08T18:59:54Z","snapshot_observed_at":"2026-08-13T13:48:07.666011Z","submitted_at":"2024-12-08T18:59:54Z","title":"Latent-Reframe: Enabling Camera Control for Video Diffusion Model without Training","version":1},"reference_index":42,"source":"pdf_text","source_observed_at":"2026-08-11T20:09:26.178025Z"},"links":{"cited_paper":"/paper/2406.02509","citing_paper":"/paper/2412.06029"},"observation_digest":"sha256:92cae3b2735217f25080f47f0aa77eb51e6b62e3cd4a08a18c252b58ed8bee0d","observation_id":"2590fe22-3bae-4736-85ee-4e428214c23b","resolution":{"observed_at":"2026-08-11T20:09:26.178025Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T20:09:26.414398Z","title":"Direct-a-video: Customized video generation with user- directed camera movement and object motion","venue":null,"work_id":"1d27d223-4a49-4b2a-86b8-fb445fed88ca","year":2024},"citing_paper":{"arxiv_id":"2412.06029","last_updated":"2024-12-08T18:59:54Z","snapshot_observed_at":"2026-08-13T13:48:07.666011Z","submitted_at":"2024-12-08T18:59:54Z","title":"Latent-Reframe: Enabling Camera Control for Video Diffusion Model without Training","version":1},"reference_index":43,"source":"pdf_text","source_observed_at":"2026-08-11T20:09:26.181298Z"},"links":{"citing_paper":"/paper/2412.06029"},"observation_digest":"sha256:67b50d9734e6eea28e4827ae78df16fddbb3ba85c66ddaed54f93b2431b236a9","observation_id":"bd40c098-42b4-4013-b9ff-cb5d317d51ac","resolution":{"observed_at":"2026-08-11T20:09:26.418277Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2410.24207","last_updated":"2024-10-31T17:58:22Z","snapshot_observed_at":"2026-08-12T22:10:19.047880Z","submitted_at":"2024-10-31T17:58:22Z","title":"No Pose, No Problem: Surprisingly Simple 3D Gaussian Splats from Sparse Unposed Images","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2410.24207","snapshot_observed_at":"2026-08-11T20:09:26.184389Z","title":"No pose, no problem: Surprisingly simple 3d gaussian splats from sparse unposed images","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2412.06029","last_updated":"2024-12-08T18:59:54Z","snapshot_observed_at":"2026-08-13T13:48:07.666011Z","submitted_at":"2024-12-08T18:59:54Z","title":"Latent-Reframe: Enabling Camera Control for Video Diffusion Model without Training","version":1},"reference_index":44,"source":"pdf_text","source_observed_at":"2026-08-11T20:09:26.184389Z"},"links":{"cited_paper":"/paper/2410.24207","citing_paper":"/paper/2412.06029"},"observation_digest":"sha256:e37882ef8ec5498cc77ceab98e986c6ae99eef33fea914a8f9596929a3cac225","observation_id":"55f58ed6-41fb-4c12-8da5-378d14c6cd3d","resolution":{"observed_at":"2026-08-11T20:09:26.184389Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2308.08089","last_updated":"2023-08-16T01:43:41Z","snapshot_observed_at":"2026-07-06T16:06:38.424057Z","submitted_at":"2023-08-16T01:43:41Z","title":"DragNUWA: Fine-grained Control in Video Generation by Integrating Text, Image, and Trajectory","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2308.08089","snapshot_observed_at":"2026-08-11T20:09:26.187222Z","title":"Dragnuwa: Fine-grained Control in Video Generation by Integrating Text, Image, and Trajectory","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2412.06029","last_updated":"2024-12-08T18:59:54Z","snapshot_observed_at":"2026-08-13T13:48:07.666011Z","submitted_at":"2024-12-08T18:59:54Z","title":"Latent-Reframe: Enabling Camera Control for Video Diffusion Model without Training","version":1},"reference_index":45,"source":"pdf_text","source_observed_at":"2026-08-11T20:09:26.187222Z"},"links":{"cited_paper":"/paper/2308.08089","citing_paper":"/paper/2412.06029"},"observation_digest":"sha256:b31f70b7fb60504f8858497cfdf3b43c9ea22f0c3041977a813152130e94f27c","observation_id":"e83e1f48-76e9-4652-b2af-b5e015e576f6","resolution":{"observed_at":"2026-08-11T20:09:26.187222Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2409.02048","last_updated":"2024-09-03T16:53:19Z","snapshot_observed_at":"2026-07-06T19:09:55.393720Z","submitted_at":"2024-09-03T16:53:19Z","title":"ViewCrafter: Taming Video Diffusion Models for High-fidelity Novel View Synthesis","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2409.02048","snapshot_observed_at":"2026-08-11T20:09:26.190032Z","title":"Viewcrafter: Taming video diffusion models for high-fidelity novel view synthesis.arXiv preprint arXiv:2409.02048, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2412.06029","last_updated":"2024-12-08T18:59:54Z","snapshot_observed_at":"2026-08-13T13:48:07.666011Z","submitted_at":"2024-12-08T18:59:54Z","title":"Latent-Reframe: Enabling Camera Control for Video Diffusion Model without Training","version":1},"reference_index":46,"source":"pdf_text","source_observed_at":"2026-08-11T20:09:26.190032Z"},"links":{"cited_paper":"/paper/2409.02048","citing_paper":"/paper/2412.06029"},"observation_digest":"sha256:ed93580998b5a402f07ade8de13158c3404d54171843b9e2edb5563f149b364d","observation_id":"d410265e-3b9e-4337-b12e-401add4067fe","resolution":{"observed_at":"2026-08-11T20:09:26.190032Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2411.05003","last_updated":"2024-11-07T18:59:45Z","snapshot_observed_at":"2026-08-12T22:05:23.810573Z","submitted_at":"2024-11-07T18:59:45Z","title":"ReCapture: Generative Video Camera Controls for User-Provided Videos using Masked Video Fine-Tuning","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2411.05003","snapshot_observed_at":"2026-08-11T20:09:26.192738Z","title":"Recapture: Gener- ative video camera controls for user-provided videos using masked video fine-tuning","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2412.06029","last_updated":"2024-12-08T18:59:54Z","snapshot_observed_at":"2026-08-13T13:48:07.666011Z","submitted_at":"2024-12-08T18:59:54Z","title":"Latent-Reframe: Enabling Camera Control for Video Diffusion Model without Training","version":1},"reference_index":47,"source":"pdf_text","source_observed_at":"2026-08-11T20:09:26.192738Z"},"links":{"cited_paper":"/paper/2411.05003","citing_paper":"/paper/2412.06029"},"observation_digest":"sha256:4683c0547431585c26d1eb6cc5b2107909a8515327cdcbf6c8497d2fdcb44ee9","observation_id":"d1130f18-a86c-48ce-9ced-e628cbf40f9f","resolution":{"observed_at":"2026-08-11T20:09:26.192738Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2410.03825","last_updated":"2025-05-08T08:32:16Z","snapshot_observed_at":"2026-07-06T19:28:08.374354Z","submitted_at":"2024-10-04T18:00:07Z","title":"MonST3R: A Simple Approach for Estimating Geometry in the Presence of Motion","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2410.03825","snapshot_observed_at":"2026-08-11T20:09:26.195788Z","title":"Monst3r: A simple approach for estimat- ing geometry in the presence of motion","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2412.06029","last_updated":"2024-12-08T18:59:54Z","snapshot_observed_at":"2026-08-13T13:48:07.666011Z","submitted_at":"2024-12-08T18:59:54Z","title":"Latent-Reframe: Enabling Camera Control for Video Diffusion Model without Training","version":1},"reference_index":48,"source":"pdf_text","source_observed_at":"2026-08-11T20:09:26.195788Z"},"links":{"cited_paper":"/paper/2410.03825","citing_paper":"/paper/2412.06029"},"observation_digest":"sha256:553df78248cb2c2d076570aded595472cff917f0a3976b3e0fabd8772df87941","observation_id":"26e1618f-0236-45a3-9ae0-79b1fb0bda40","resolution":{"observed_at":"2026-08-11T20:09:26.195788Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2404.07206","last_updated":"2024-04-10T17:59:59Z","snapshot_observed_at":"2026-08-13T00:33:11.789785Z","submitted_at":"2024-04-10T17:59:59Z","title":"GoodDrag: Towards Good Practices for Drag Editing with Diffusion Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2404.07206","snapshot_observed_at":"2026-08-11T20:09:26.198399Z","title":"Good- drag: Towards good practices for drag editing with diffusion models","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2412.06029","last_updated":"2024-12-08T18:59:54Z","snapshot_observed_at":"2026-08-13T13:48:07.666011Z","submitted_at":"2024-12-08T18:59:54Z","title":"Latent-Reframe: Enabling Camera Control for Video Diffusion Model without Training","version":1},"reference_index":49,"source":"pdf_text","source_observed_at":"2026-08-11T20:09:26.198399Z"},"links":{"cited_paper":"/paper/2404.07206","citing_paper":"/paper/2412.06029"},"observation_digest":"sha256:95984a3bfca37bc4f3853380c0e1d0c2f19aa221309e9c08f1463d51e691a73d","observation_id":"ca5addaa-c94e-4e1c-b84f-e915a73c9fc8","resolution":{"observed_at":"2026-08-11T20:09:26.198399Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1805.09817","last_updated":"2018-05-24T17:58:02Z","snapshot_observed_at":"2026-07-06T06:41:05.545426Z","submitted_at":"2018-05-24T17:58:02Z","title":"Stereo Magnification: Learning View Synthesis using Multiplane Images","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1805.09817","snapshot_observed_at":"2026-08-11T20:09:26.201718Z","title":"Stereo magnification: Learning view synthesis using multiplane images","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2412.06029","last_updated":"2024-12-08T18:59:54Z","snapshot_observed_at":"2026-08-13T13:48:07.666011Z","submitted_at":"2024-12-08T18:59:54Z","title":"Latent-Reframe: Enabling Camera Control for Video Diffusion Model without Training","version":1},"reference_index":50,"source":"pdf_text","source_observed_at":"2026-08-11T20:09:26.201718Z"},"links":{"cited_paper":"/paper/1805.09817","citing_paper":"/paper/2412.06029"},"observation_digest":"sha256:a73c66efb588bfa4329994239d131cc1e53afd2a4c0c3f7fd9462ae99bb709e6","observation_id":"495511b9-182f-4105-a368-40eb1a8cbb5f","resolution":{"observed_at":"2026-08-11T20:09:26.201718Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T20:09:26.406484Z","title":"Denoising is conducted using the video diffusion model until reaching the predetermined latent reframing step, which is step 8","venue":null,"work_id":"112cc974-6534-4029-839d-f2fad541adcd","year":null},"citing_paper":{"arxiv_id":"2412.06029","last_updated":"2024-12-08T18:59:54Z","snapshot_observed_at":"2026-08-13T13:48:07.666011Z","submitted_at":"2024-12-08T18:59:54Z","title":"Latent-Reframe: Enabling Camera Control for Video Diffusion Model without Training","version":1},"reference_index":51,"source":"pdf_text","source_observed_at":"2026-08-11T20:09:26.205649Z"},"links":{"citing_paper":"/paper/2412.06029"},"observation_digest":"sha256:9f7c17ba26bd7ad670c85b1be2016fd636a69fa2645632fb54ba1fb03d73ca1f","observation_id":"184b73bf-6bbb-4cf3-9afe-5cefe9fc8627","resolution":{"observed_at":"2026-08-11T20:09:26.409363Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T20:09:26.397164Z","title":"3.2, is then applied to generate the reframed video at the target camera pose","venue":null,"work_id":"ffd65d74-9862-4aa0-bc85-1be3eccbbbae","year":null},"citing_paper":{"arxiv_id":"2412.06029","last_updated":"2024-12-08T18:59:54Z","snapshot_observed_at":"2026-08-13T13:48:07.666011Z","submitted_at":"2024-12-08T18:59:54Z","title":"Latent-Reframe: Enabling Camera Control for Video Diffusion Model without Training","version":1},"reference_index":52,"source":"pdf_text","source_observed_at":"2026-08-11T20:09:26.208723Z"},"links":{"citing_paper":"/paper/2412.06029"},"observation_digest":"sha256:9d4b3cfc759dceea6607ca94615b0ae71d3b8f7eed9a616ff1365f1164837d4d","observation_id":"816b8473-d6a2-42f7-a70a-1ff99592800e","resolution":{"observed_at":"2026-08-11T20:09:26.400492Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T20:09:26.388415Z","title":"As outlined in Sec","venue":null,"work_id":"45998ca4-8223-4495-8a5e-2e04ae743420","year":null},"citing_paper":{"arxiv_id":"2412.06029","last_updated":"2024-12-08T18:59:54Z","snapshot_observed_at":"2026-08-13T13:48:07.666011Z","submitted_at":"2024-12-08T18:59:54Z","title":"Latent-Reframe: Enabling Camera Control for Video Diffusion Model without Training","version":1},"reference_index":53,"source":"pdf_text","source_observed_at":"2026-08-11T20:09:26.211115Z"},"links":{"citing_paper":"/paper/2412.06029"},"observation_digest":"sha256:3af3e981e34e7301b6602b2fff06c40b2a442e5e47610299e98f917caf844c51","observation_id":"1c7457cd-8c84-4135-931d-9674c5488aae","resolution":{"observed_at":"2026-08-11T20:09:26.391325Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T20:09:26.380573Z","title":"At this stage, the input to the denoising network combines un- known and known regions, as described in Eq","venue":null,"work_id":"14c6c83c-b205-4882-ac5d-e65b684a8ee4","year":null},"citing_paper":{"arxiv_id":"2412.06029","last_updated":"2024-12-08T18:59:54Z","snapshot_observed_at":"2026-08-13T13:48:07.666011Z","submitted_at":"2024-12-08T18:59:54Z","title":"Latent-Reframe: Enabling Camera Control for Video Diffusion Model without Training","version":1},"reference_index":54,"source":"pdf_text","source_observed_at":"2026-08-11T20:09:26.214345Z"},"links":{"citing_paper":"/paper/2412.06029"},"observation_digest":"sha256:6445714e6797d03f168ac21991144ccc8180c7b97109f865966facc34b2f28d2","observation_id":"33654b29-9b04-4df5-8b32-2184c0a07842","resolution":{"observed_at":"2026-08-11T20:09:26.383889Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T20:09:26.372591Z","title":"After this, the known region is no longer merged","venue":null,"work_id":"2530f981-500e-4f19-8c97-80f062f61152","year":null},"citing_paper":{"arxiv_id":"2412.06029","last_updated":"2024-12-08T18:59:54Z","snapshot_observed_at":"2026-08-13T13:48:07.666011Z","submitted_at":"2024-12-08T18:59:54Z","title":"Latent-Reframe: Enabling Camera Control for Video Diffusion Model without Training","version":1},"reference_index":55,"source":"pdf_text","source_observed_at":"2026-08-11T20:09:26.217767Z"},"links":{"citing_paper":"/paper/2412.06029"},"observation_digest":"sha256:04b87ff1b9fbcbaf9d314c8f762c88fd2635913f74d69ae5311cfc332cbdf9ad","observation_id":"1609c16c-0273-4805-aabb-216b985fda7c","resolution":{"observed_at":"2026-08-11T20:09:26.375955Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}}],"paper":{"arxiv_id":"2412.06029","last_updated":"2024-12-08T18:59:54Z","latest_version":1,"primary_category":"cs.CV","snapshot_observed_at":"2026-08-13T13:48:07.666011Z","submitted_at":"2024-12-08T18:59:54Z","title":"Latent-Reframe: Enabling Camera Control for Video Diffusion Model without Training"},"reference_resolution":{"displayed":55,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":30,"verified_exact":1,"verified_fuzzy":24},"total_outbound_references":55},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"thesis":"As of 14 August 2026, this Paper Citation Record lists 55 of 55 outbound references and 1 inbound Pith citation observation for arXiv:2412.06029."}