{"as_of":"2026-08-10T09:58:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:4c31f5d6bc8a9a8861fcb3fac62a4adf678a82725dbf146adec4b47ac3ddf0a9","coverage":[{"denominator":126,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":100,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-05T22:21:05.627730Z","state":"measured"},{"denominator":100,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":100,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-10T06:31:04.303077+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2508.07246/citation-record","integrity":"/paper/2508.07246/integrity","json":"/paper/2508.07246/citation-record.json","paper":"/paper/2508.07246"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T22:21:05.225244Z","title":"Pia: Your personalized image animator via plug-and-play modules in text-to- image models,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2508.07246","last_updated":"2025-08-10T08:59:32Z","snapshot_observed_at":"2026-08-09T17:42:18.989378Z","submitted_at":"2025-08-10T08:59:32Z","title":"Consistent and Controllable Image Animation with Motion Linear Diffusion Transformers","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-05T22:21:05.225244Z"},"links":{"citing_paper":"/paper/2508.07246"},"observation_digest":"sha256:fccd653d9edc8911a2c233fa07dcf9fa57f2d7e2817588620567faffe1febfe9","observation_id":"544c70da-16fe-4064-89f5-b152bc4b6fd9","resolution":{"observed_at":"2026-08-05T22:21:05.225244Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T22:21:05.229687Z","title":"Seine: Short-to-long video diffusion model for generative transition and prediction,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2508.07246","last_updated":"2025-08-10T08:59:32Z","snapshot_observed_at":"2026-08-09T17:42:18.989378Z","submitted_at":"2025-08-10T08:59:32Z","title":"Consistent and Controllable Image Animation with Motion Linear Diffusion Transformers","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-05T22:21:05.229687Z"},"links":{"citing_paper":"/paper/2508.07246"},"observation_digest":"sha256:a50ef47b68b750a4c9af7445cf9fed191766da97e24bc36824dc5b3f7fdaf82a","observation_id":"7b4f5d49-53eb-466d-8937-76992c4b093c","resolution":{"observed_at":"2026-08-05T22:21:05.229687Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T22:21:05.233637Z","title":"High- resolution image synthesis with latent diffusion models,","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2508.07246","last_updated":"2025-08-10T08:59:32Z","snapshot_observed_at":"2026-08-09T17:42:18.989378Z","submitted_at":"2025-08-10T08:59:32Z","title":"Consistent and Controllable Image Animation with Motion Linear Diffusion Transformers","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-05T22:21:05.233637Z"},"links":{"citing_paper":"/paper/2508.07246"},"observation_digest":"sha256:57d4ab3a2fef6cbe337055f9e4127e10bd4322490f140c6664cf06858e8f2a6a","observation_id":"d7420806-548b-4059-a8a1-a0a52b2e43a5","resolution":{"observed_at":"2026-08-05T22:21:05.233637Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T22:21:05.237480Z","title":"Pixart- α: Fast training of diffusion transformer for photorealistic text-to-image synthesis,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2508.07246","last_updated":"2025-08-10T08:59:32Z","snapshot_observed_at":"2026-08-09T17:42:18.989378Z","submitted_at":"2025-08-10T08:59:32Z","title":"Consistent and Controllable Image Animation with Motion Linear Diffusion Transformers","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-05T22:21:05.237480Z"},"links":{"citing_paper":"/paper/2508.07246"},"observation_digest":"sha256:3db8a37cfd50b041f7d88beff27399d2104a206f71695abb59475e11e13d00e9","observation_id":"7e09b4fd-248f-4160-8a03-9b043dd1543c","resolution":{"observed_at":"2026-08-05T22:21:05.237480Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T22:21:05.241224Z","title":"Sdxl: Improving latent diffusion models for high-resolution image synthesis,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2508.07246","last_updated":"2025-08-10T08:59:32Z","snapshot_observed_at":"2026-08-09T17:42:18.989378Z","submitted_at":"2025-08-10T08:59:32Z","title":"Consistent and Controllable Image Animation with Motion Linear Diffusion Transformers","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-05T22:21:05.241224Z"},"links":{"citing_paper":"/paper/2508.07246"},"observation_digest":"sha256:977901157238d3cf8874311b4dfdbc609c3a4e7f48421df89a701944dddb08c0","observation_id":"9b5c5dcc-e714-44ca-b2a8-cf58c5aea7f6","resolution":{"observed_at":"2026-08-05T22:21:05.241224Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T22:21:05.245282Z","title":"Magic3d: High-resolution text- to-3d content creation,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2508.07246","last_updated":"2025-08-10T08:59:32Z","snapshot_observed_at":"2026-08-09T17:42:18.989378Z","submitted_at":"2025-08-10T08:59:32Z","title":"Consistent and Controllable Image Animation with Motion Linear Diffusion Transformers","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-05T22:21:05.245282Z"},"links":{"citing_paper":"/paper/2508.07246"},"observation_digest":"sha256:21017a1e9964cf3fa1b170c03dd131a4ef45e589137f696c1fc3af4ad6bdc468","observation_id":"4f16d21f-91ab-4592-82c8-05dc6e8b490a","resolution":{"observed_at":"2026-08-05T22:21:05.245282Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T22:21:05.249481Z","title":"Dreamfusion: Text- to-3d using 2d diffusion,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2508.07246","last_updated":"2025-08-10T08:59:32Z","snapshot_observed_at":"2026-08-09T17:42:18.989378Z","submitted_at":"2025-08-10T08:59:32Z","title":"Consistent and Controllable Image Animation with Motion Linear Diffusion Transformers","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-05T22:21:05.249481Z"},"links":{"citing_paper":"/paper/2508.07246"},"observation_digest":"sha256:24638237badfa668272f9ebd56cdf63bbc0007e7cced23e9aeb9966a438f3cbb","observation_id":"7ab5da85-9623-46c1-9a68-9a86f379f645","resolution":{"observed_at":"2026-08-05T22:21:05.249481Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T22:21:05.253183Z","title":"Instant3d: Fast text-to-3d with sparse- view generation and large reconstruction model,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2508.07246","last_updated":"2025-08-10T08:59:32Z","snapshot_observed_at":"2026-08-09T17:42:18.989378Z","submitted_at":"2025-08-10T08:59:32Z","title":"Consistent and Controllable Image Animation with Motion Linear Diffusion Transformers","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-05T22:21:05.253183Z"},"links":{"citing_paper":"/paper/2508.07246"},"observation_digest":"sha256:4ba377951160b3a3984e1f87d5b4a5da372d5330b7ea13825481da01af1fa57b","observation_id":"c2c1f721-20ab-4ae6-b7fc-2f75c3813409","resolution":{"observed_at":"2026-08-05T22:21:05.253183Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T22:21:05.257105Z","title":"Lavie: High-quality video generation with cascaded latent diffusion models,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2508.07246","last_updated":"2025-08-10T08:59:32Z","snapshot_observed_at":"2026-08-09T17:42:18.989378Z","submitted_at":"2025-08-10T08:59:32Z","title":"Consistent and Controllable Image Animation with Motion Linear Diffusion Transformers","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-05T22:21:05.257105Z"},"links":{"citing_paper":"/paper/2508.07246"},"observation_digest":"sha256:acceb25e7a09e4142a46e9bbffb3bfb9f111a3bda9816434d7b27986f270cedc","observation_id":"d439cb51-662c-4f06-97af-24d5cef6440a","resolution":{"observed_at":"2026-08-05T22:21:05.257105Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T22:21:05.261188Z","title":"Latte: Latent diffusion transformer for video generation,","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2508.07246","last_updated":"2025-08-10T08:59:32Z","snapshot_observed_at":"2026-08-09T17:42:18.989378Z","submitted_at":"2025-08-10T08:59:32Z","title":"Consistent and Controllable Image Animation with Motion Linear Diffusion Transformers","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-05T22:21:05.261188Z"},"links":{"citing_paper":"/paper/2508.07246"},"observation_digest":"sha256:c465693d365934e4d794bcd0ce28c7b698fb616b4709d906a457ec759960260a","observation_id":"76234929-dbcb-425d-8047-b7f7a70beb68","resolution":{"observed_at":"2026-08-05T22:21:05.261188Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T22:21:05.265481Z","title":"Align your latents: High-resolution video synthesis with latent diffusion models,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2508.07246","last_updated":"2025-08-10T08:59:32Z","snapshot_observed_at":"2026-08-09T17:42:18.989378Z","submitted_at":"2025-08-10T08:59:32Z","title":"Consistent and Controllable Image Animation with Motion Linear Diffusion Transformers","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-05T22:21:05.265481Z"},"links":{"citing_paper":"/paper/2508.07246"},"observation_digest":"sha256:1b298a5bd906c57e67d71a26a39bac719ed8c1a490494c41117e6908631b6876","observation_id":"30eddb13-216a-4f55-aff6-f3027b4bf74d","resolution":{"observed_at":"2026-08-05T22:21:05.265481Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T22:21:05.269291Z","title":"Videofusion: Decomposed diffusion models for high-quality video generation,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2508.07246","last_updated":"2025-08-10T08:59:32Z","snapshot_observed_at":"2026-08-09T17:42:18.989378Z","submitted_at":"2025-08-10T08:59:32Z","title":"Consistent and Controllable Image Animation with Motion Linear Diffusion Transformers","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-05T22:21:05.269291Z"},"links":{"citing_paper":"/paper/2508.07246"},"observation_digest":"sha256:9a415c1f74e830b5679042824bb7dc6c169a8456b2a4675e6a829498cd2c9bcb","observation_id":"3cf54f50-40f8-4713-9c8b-c89e50766894","resolution":{"observed_at":"2026-08-05T22:21:05.269291Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T22:21:05.273026Z","title":"Make-a-video: Text-to-video generation without text-video data,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2508.07246","last_updated":"2025-08-10T08:59:32Z","snapshot_observed_at":"2026-08-09T17:42:18.989378Z","submitted_at":"2025-08-10T08:59:32Z","title":"Consistent and Controllable Image Animation with Motion Linear Diffusion Transformers","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-05T22:21:05.273026Z"},"links":{"citing_paper":"/paper/2508.07246"},"observation_digest":"sha256:bedf148b6e1d7ac802ee759c1a5ebfda31cc92345f5c9d0fc99e28fae178142f","observation_id":"5ef384cf-4047-44f3-8ba7-bd532285666c","resolution":{"observed_at":"2026-08-05T22:21:05.273026Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T22:21:05.276765Z","title":"Animatediff: Animate your personalized text-to-image diffusion mod- els without specific tuning,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2508.07246","last_updated":"2025-08-10T08:59:32Z","snapshot_observed_at":"2026-08-09T17:42:18.989378Z","submitted_at":"2025-08-10T08:59:32Z","title":"Consistent and Controllable Image Animation with Motion Linear Diffusion Transformers","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-05T22:21:05.276765Z"},"links":{"citing_paper":"/paper/2508.07246"},"observation_digest":"sha256:f8820874eb3ffc3bb61c8296b56c54512ad7cbcee66b91993ce4679b192e1450","observation_id":"999488a5-e230-4fab-80f9-dd9ba77dc62c","resolution":{"observed_at":"2026-08-05T22:21:05.276765Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T22:21:05.280745Z","title":"Animateanything: Fine-grained open domain image animation with motion guidance,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2508.07246","last_updated":"2025-08-10T08:59:32Z","snapshot_observed_at":"2026-08-09T17:42:18.989378Z","submitted_at":"2025-08-10T08:59:32Z","title":"Consistent and Controllable Image Animation with Motion Linear Diffusion Transformers","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-05T22:21:05.280745Z"},"links":{"citing_paper":"/paper/2508.07246"},"observation_digest":"sha256:8e93c565b88b505d46e63b9eb0bcb840dffcd89498b10bbdde6c3b9c96619103","observation_id":"c002b20f-7906-4bea-92ca-060e56799477","resolution":{"observed_at":"2026-08-05T22:21:05.280745Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T22:21:05.284977Z","title":"Dynamicrafter: Animating open-domain images with video diffusion priors,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2508.07246","last_updated":"2025-08-10T08:59:32Z","snapshot_observed_at":"2026-08-09T17:42:18.989378Z","submitted_at":"2025-08-10T08:59:32Z","title":"Consistent and Controllable Image Animation with Motion Linear Diffusion Transformers","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-05T22:21:05.284977Z"},"links":{"citing_paper":"/paper/2508.07246"},"observation_digest":"sha256:34929cadb87c18796c49acd2757e5c0654b0b2e5ef35022808ab5475d7bfaf74","observation_id":"16913b93-2058-4e32-bb3f-0d3ad675013b","resolution":{"observed_at":"2026-08-05T22:21:05.284977Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2311.04145","last_updated":"2023-11-07T17:16:06Z","snapshot_observed_at":"2026-08-02T12:25:34.488259Z","submitted_at":"2023-11-07T17:16:06Z","title":"I2VGen-XL: High-Quality Image-to-Video Synthesis via Cascaded Diffusion Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2311.04145","snapshot_observed_at":"2026-08-05T22:21:05.289176Z","title":"I2vgen-xl: High-quality image-to-video synthe- sis via cascaded diffusion models,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2508.07246","last_updated":"2025-08-10T08:59:32Z","snapshot_observed_at":"2026-08-09T17:42:18.989378Z","submitted_at":"2025-08-10T08:59:32Z","title":"Consistent and Controllable Image Animation with Motion Linear Diffusion Transformers","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-05T22:21:05.289176Z"},"links":{"cited_paper":"/paper/2311.04145","citing_paper":"/paper/2508.07246"},"observation_digest":"sha256:0d0675030fec32a4804c17213d00a75b8bac008d94af6fff2ae45f2a2af9b5a3","observation_id":"73f67e8e-4294-45f5-8978-a87b896ef95b","resolution":{"observed_at":"2026-08-05T22:21:05.289176Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T22:21:05.293666Z","title":"Consisti2v: Enhancing visual consistency for image-to-video genera- tion,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2508.07246","last_updated":"2025-08-10T08:59:32Z","snapshot_observed_at":"2026-08-09T17:42:18.989378Z","submitted_at":"2025-08-10T08:59:32Z","title":"Consistent and Controllable Image Animation with Motion Linear Diffusion Transformers","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-05T22:21:05.293666Z"},"links":{"citing_paper":"/paper/2508.07246"},"observation_digest":"sha256:53368e596e6f154a04021b31da15e86eea0b0da06a14c3fb8377b58ed74bb2a4","observation_id":"fbbaf1b5-fd8b-43df-9290-c5050f73555f","resolution":{"observed_at":"2026-08-05T22:21:05.293666Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T22:21:05.297907Z","title":"Motionstone: Decoupled motion intensity modulation with diffusion transformer for image-to-video generation,","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2508.07246","last_updated":"2025-08-10T08:59:32Z","snapshot_observed_at":"2026-08-09T17:42:18.989378Z","submitted_at":"2025-08-10T08:59:32Z","title":"Consistent and Controllable Image Animation with Motion Linear Diffusion Transformers","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-05T22:21:05.297907Z"},"links":{"citing_paper":"/paper/2508.07246"},"observation_digest":"sha256:a0b4bcc30a7ff6f66af79989905672589d7e26aaa78f125387c141aee4cf7cc2","observation_id":"c03c23e8-0bab-4158-9b20-4201ff40442c","resolution":{"observed_at":"2026-08-05T22:21:05.297907Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T22:21:05.301967Z","title":"Through-the-mask: Mask-based motion trajectories for image-to-video generation,","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2508.07246","last_updated":"2025-08-10T08:59:32Z","snapshot_observed_at":"2026-08-09T17:42:18.989378Z","submitted_at":"2025-08-10T08:59:32Z","title":"Consistent and Controllable Image Animation with Motion Linear Diffusion Transformers","version":1},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-05T22:21:05.301967Z"},"links":{"citing_paper":"/paper/2508.07246"},"observation_digest":"sha256:900afafe272a9c6ff791eb6b163349e5d3272b24032fda3ac8373fb5a89167a9","observation_id":"0a038a29-a650-4b95-ab7d-c465eef3547a","resolution":{"observed_at":"2026-08-05T22:21:05.301967Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T22:21:05.305953Z","title":"Extrapolating and decoupling image-to-video generation models: Motion modeling is easier than you think,","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2508.07246","last_updated":"2025-08-10T08:59:32Z","snapshot_observed_at":"2026-08-09T17:42:18.989378Z","submitted_at":"2025-08-10T08:59:32Z","title":"Consistent and Controllable Image Animation with Motion Linear Diffusion Transformers","version":1},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-05T22:21:05.305953Z"},"links":{"citing_paper":"/paper/2508.07246"},"observation_digest":"sha256:105ce996a384602680255f5d8f6e51ba394099d122937f7c0f51028c6ee71859","observation_id":"5e6dea54-4326-4ba5-8e6a-b5b7c30ed71c","resolution":{"observed_at":"2026-08-05T22:21:05.305953Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T22:21:05.309809Z","title":"I2vguard: Safeguarding images against misuse in diffusion-based image-to-video models,","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2508.07246","last_updated":"2025-08-10T08:59:32Z","snapshot_observed_at":"2026-08-09T17:42:18.989378Z","submitted_at":"2025-08-10T08:59:32Z","title":"Consistent and Controllable Image Animation with Motion Linear Diffusion Transformers","version":1},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-05T22:21:05.309809Z"},"links":{"citing_paper":"/paper/2508.07246"},"observation_digest":"sha256:c8e26e4ae2b50a5cd2bab4ca480f9164bd4984560f7aedd15429431838aa5776","observation_id":"bd9d6b29-6a8d-48c1-a5ac-9abb73bef7e8","resolution":{"observed_at":"2026-08-05T22:21:05.309809Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T22:21:05.313968Z","title":"Mo- tionpro: A precise motion controller for image-to-video generation,","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2508.07246","last_updated":"2025-08-10T08:59:32Z","snapshot_observed_at":"2026-08-09T17:42:18.989378Z","submitted_at":"2025-08-10T08:59:32Z","title":"Consistent and Controllable Image Animation with Motion Linear Diffusion Transformers","version":1},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-05T22:21:05.313968Z"},"links":{"citing_paper":"/paper/2508.07246"},"observation_digest":"sha256:2353d2c3f4abea529221dc7cdffb218230f004b7907427755cac472dd1a03191","observation_id":"5909ee57-aa97-436f-b0f3-83d28fde926e","resolution":{"observed_at":"2026-08-05T22:21:05.313968Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T22:21:05.317647Z","title":"Levitor: 3d trajectory oriented image-to-video synthesis,","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2508.07246","last_updated":"2025-08-10T08:59:32Z","snapshot_observed_at":"2026-08-09T17:42:18.989378Z","submitted_at":"2025-08-10T08:59:32Z","title":"Consistent and Controllable Image Animation with Motion Linear Diffusion Transformers","version":1},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-05T22:21:05.317647Z"},"links":{"citing_paper":"/paper/2508.07246"},"observation_digest":"sha256:dede7d6521759b34b35e156c7494d5e831da2828991c4c2fa6ddb79f3a8fd1cc","observation_id":"3499adc1-b1ff-40c2-84df-de0dc37b56c3","resolution":{"observed_at":"2026-08-05T22:21:05.317647Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T22:21:05.321497Z","title":"Osv: One step is enough for high-quality image to video generation,","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2508.07246","last_updated":"2025-08-10T08:59:32Z","snapshot_observed_at":"2026-08-09T17:42:18.989378Z","submitted_at":"2025-08-10T08:59:32Z","title":"Consistent and Controllable Image Animation with Motion Linear Diffusion Transformers","version":1},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-08-05T22:21:05.321497Z"},"links":{"citing_paper":"/paper/2508.07246"},"observation_digest":"sha256:02dbc72fad863c9f1f8c374f939dbd15a7dd5c2299e57f07a25f6e01e53f4dfe","observation_id":"52b3cd96-5019-4b3b-ba1d-9128b9872e9e","resolution":{"observed_at":"2026-08-05T22:21:05.321497Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T22:21:05.325267Z","title":"Motif: Making text count in image animation with motion focal loss,","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2508.07246","last_updated":"2025-08-10T08:59:32Z","snapshot_observed_at":"2026-08-09T17:42:18.989378Z","submitted_at":"2025-08-10T08:59:32Z","title":"Consistent and Controllable Image Animation with Motion Linear Diffusion Transformers","version":1},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-08-05T22:21:05.325267Z"},"links":{"citing_paper":"/paper/2508.07246"},"observation_digest":"sha256:30bd2dc9771746e48b96f2607fae0fb635d682184280068cc1f6d6737ab4c184","observation_id":"605f4211-1137-40d0-990b-10bb77472ab5","resolution":{"observed_at":"2026-08-05T22:21:05.325267Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2412.03603","last_updated":"2025-03-11T08:14:25Z","snapshot_observed_at":"2026-08-03T00:44:01.942521Z","submitted_at":"2024-12-03T23:52:37Z","title":"HunyuanVideo: A Systematic Framework For Large Video Generative Models","version":6},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2412.03603","snapshot_observed_at":"2026-08-05T22:21:05.329328Z","title":"Hunyuanvideo: A systematic framework for large video generative models,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2508.07246","last_updated":"2025-08-10T08:59:32Z","snapshot_observed_at":"2026-08-09T17:42:18.989378Z","submitted_at":"2025-08-10T08:59:32Z","title":"Consistent and Controllable Image Animation with Motion Linear Diffusion Transformers","version":1},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-08-05T22:21:05.329328Z"},"links":{"cited_paper":"/paper/2412.03603","citing_paper":"/paper/2508.07246"},"observation_digest":"sha256:9c77dca5efa8caf2309b9693f125b11f0e018ba4bfb443fe4b7cf0811095c057","observation_id":"d76689e0-03a3-46d6-890b-967f5a9caab6","resolution":{"observed_at":"2026-08-05T22:21:05.329328Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2503.20314","last_updated":"2025-04-19T02:22:42Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-03-26T08:25:43Z","title":"Wan: Open and Advanced Large-Scale Video Generative Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2503.20314","snapshot_observed_at":"2026-08-05T22:21:05.333534Z","title":"Wan: Open and advanced large-scale video generative models,","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2508.07246","last_updated":"2025-08-10T08:59:32Z","snapshot_observed_at":"2026-08-09T17:42:18.989378Z","submitted_at":"2025-08-10T08:59:32Z","title":"Consistent and Controllable Image Animation with Motion Linear Diffusion Transformers","version":1},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-08-05T22:21:05.333534Z"},"links":{"cited_paper":"/paper/2503.20314","citing_paper":"/paper/2508.07246"},"observation_digest":"sha256:3b87919d080cc39420198396366209cd64384fc49cbdc6ee7399746bdc3739c7","observation_id":"400cb414-25b0-42fa-8d71-f772abf44982","resolution":{"observed_at":"2026-08-05T22:21:05.333534Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T22:21:05.337802Z","title":"Cogvideox: Text-to-video diffu- sion models with an expert transformer,","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2508.07246","last_updated":"2025-08-10T08:59:32Z","snapshot_observed_at":"2026-08-09T17:42:18.989378Z","submitted_at":"2025-08-10T08:59:32Z","title":"Consistent and Controllable Image Animation with Motion Linear Diffusion Transformers","version":1},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-08-05T22:21:05.337802Z"},"links":{"citing_paper":"/paper/2508.07246"},"observation_digest":"sha256:fde2794a5a9071ea624099107d70eed87f6b39c945f7b963515b52905562f05a","observation_id":"6f96a681-9b8e-4337-9e9d-d0668a4ade73","resolution":{"observed_at":"2026-08-05T22:21:05.337802Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2412.00131","last_updated":"2024-11-28T14:07:45Z","snapshot_observed_at":"2026-08-09T23:28:59.299375Z","submitted_at":"2024-11-28T14:07:45Z","title":"Open-Sora Plan: Open-Source Large Video Generation Model","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2412.00131","snapshot_observed_at":"2026-08-05T22:21:05.341735Z","title":"Open-sora plan: Open-source large video generation model,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2508.07246","last_updated":"2025-08-10T08:59:32Z","snapshot_observed_at":"2026-08-09T17:42:18.989378Z","submitted_at":"2025-08-10T08:59:32Z","title":"Consistent and Controllable Image Animation with Motion Linear Diffusion Transformers","version":1},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-08-05T22:21:05.341735Z"},"links":{"cited_paper":"/paper/2412.00131","citing_paper":"/paper/2508.07246"},"observation_digest":"sha256:ff20acb21a83ee8bb4184ebc34d7aad8fa5490fa279117a5f102bf681dc3151a","observation_id":"33eeba43-30af-442d-a6ff-06604d18374b","resolution":{"observed_at":"2026-08-05T22:21:05.341735Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2412.20404","last_updated":"2024-12-29T08:52:49Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-12-29T08:52:49Z","title":"Open-Sora: Democratizing Efficient Video Production for All","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2412.20404","snapshot_observed_at":"2026-08-05T22:21:05.345866Z","title":"Open-sora: Democratizing efficient video production for all,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2508.07246","last_updated":"2025-08-10T08:59:32Z","snapshot_observed_at":"2026-08-09T17:42:18.989378Z","submitted_at":"2025-08-10T08:59:32Z","title":"Consistent and Controllable Image Animation with Motion Linear Diffusion Transformers","version":1},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-08-05T22:21:05.345866Z"},"links":{"cited_paper":"/paper/2412.20404","citing_paper":"/paper/2508.07246"},"observation_digest":"sha256:518cc5f6a79c39b6d5e58f80c6a4454e55b90db6b750a4df542d0270e7a42f88","observation_id":"8e097f93-7af7-4e21-8401-39013c53fc8a","resolution":{"observed_at":"2026-08-05T22:21:05.345866Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2501.00103","last_updated":"2024-12-30T19:00:25Z","snapshot_observed_at":"2026-07-06T20:14:54.297131Z","submitted_at":"2024-12-30T19:00:25Z","title":"LTX-Video: Realtime Video Latent Diffusion","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2501.00103","snapshot_observed_at":"2026-08-05T22:21:05.350609Z","title":"Ltx-video: Realtime video latent diffusion,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2508.07246","last_updated":"2025-08-10T08:59:32Z","snapshot_observed_at":"2026-08-09T17:42:18.989378Z","submitted_at":"2025-08-10T08:59:32Z","title":"Consistent and Controllable Image Animation with Motion Linear Diffusion Transformers","version":1},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-08-05T22:21:05.350609Z"},"links":{"cited_paper":"/paper/2501.00103","citing_paper":"/paper/2508.07246"},"observation_digest":"sha256:1cdb16b72fa700ab1707df95369b4123efcae7a1586a68c4e2b3ccbce92154c4","observation_id":"def21ad9-9836-4a6b-b6ec-d1e5cbcb5577","resolution":{"observed_at":"2026-08-05T22:21:05.350609Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T22:21:05.354976Z","title":"Roformer: En- hanced transformer with rotary position embedding,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2508.07246","last_updated":"2025-08-10T08:59:32Z","snapshot_observed_at":"2026-08-09T17:42:18.989378Z","submitted_at":"2025-08-10T08:59:32Z","title":"Consistent and Controllable Image Animation with Motion Linear Diffusion Transformers","version":1},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-08-05T22:21:05.354976Z"},"links":{"citing_paper":"/paper/2508.07246"},"observation_digest":"sha256:bfab6f3c967213cfc030330e34d59421aac60b41a6f93d47321f6bc5848e3a22","observation_id":"9b3e40d5-2ba4-4439-b0bd-c5afde5062fd","resolution":{"observed_at":"2026-08-05T22:21:05.354976Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T22:21:05.359079Z","title":"Freeu: Free lunch in diffusion u-net,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2508.07246","last_updated":"2025-08-10T08:59:32Z","snapshot_observed_at":"2026-08-09T17:42:18.989378Z","submitted_at":"2025-08-10T08:59:32Z","title":"Consistent and Controllable Image Animation with Motion Linear Diffusion Transformers","version":1},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-08-05T22:21:05.359079Z"},"links":{"citing_paper":"/paper/2508.07246"},"observation_digest":"sha256:c9a84c8e9fb31159522d5d5b7ef48abce109b5058ad86e8c36f89c6f468ee12c","observation_id":"4fe296c5-0395-43a4-b837-59ef21a9f625","resolution":{"observed_at":"2026-08-05T22:21:05.359079Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T22:21:05.363305Z","title":"Freeinit: Bridging initialization gap in video diffusion models,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2508.07246","last_updated":"2025-08-10T08:59:32Z","snapshot_observed_at":"2026-08-09T17:42:18.989378Z","submitted_at":"2025-08-10T08:59:32Z","title":"Consistent and Controllable Image Animation with Motion Linear Diffusion Transformers","version":1},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-08-05T22:21:05.363305Z"},"links":{"citing_paper":"/paper/2508.07246"},"observation_digest":"sha256:f2099051cccd9e983211be45b05f154c79f8a703aa869c8608c1ca0a8c2ae9fa","observation_id":"e3475f27-e66b-4d4a-9898-c72ff4b23fd6","resolution":{"observed_at":"2026-08-05T22:21:05.363305Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T22:21:05.367428Z","title":"Input perturbation reduces exposure bias in diffusion models,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2508.07246","last_updated":"2025-08-10T08:59:32Z","snapshot_observed_at":"2026-08-09T17:42:18.989378Z","submitted_at":"2025-08-10T08:59:32Z","title":"Consistent and Controllable Image Animation with Motion Linear Diffusion Transformers","version":1},"reference_index":36,"source":"pdf_text","source_observed_at":"2026-08-05T22:21:05.367428Z"},"links":{"citing_paper":"/paper/2508.07246"},"observation_digest":"sha256:4347f16aea43bdc8275caba5f162cc5d798b4b70452af4fcac30789af44ccdba","observation_id":"6a9c1298-864a-4422-9b24-746f99c1e270","resolution":{"observed_at":"2026-08-05T22:21:05.367428Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T22:21:05.371619Z","title":"Consistent and controllable image animation with motion diffusion models,","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2508.07246","last_updated":"2025-08-10T08:59:32Z","snapshot_observed_at":"2026-08-09T17:42:18.989378Z","submitted_at":"2025-08-10T08:59:32Z","title":"Consistent and Controllable Image Animation with Motion Linear Diffusion Transformers","version":1},"reference_index":37,"source":"pdf_text","source_observed_at":"2026-08-05T22:21:05.371619Z"},"links":{"citing_paper":"/paper/2508.07246"},"observation_digest":"sha256:8498b2ce51daea763ace38801c4c09f1d005e591ea1c99bc1af5d184e393de8e","observation_id":"c2da1a57-b343-42d4-ad7e-a6112bc70426","resolution":{"observed_at":"2026-08-05T22:21:05.371619Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T22:21:05.375564Z","title":"Sana: Efficient high-resolution image synthesis with linear diffusion transformers,","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2508.07246","last_updated":"2025-08-10T08:59:32Z","snapshot_observed_at":"2026-08-09T17:42:18.989378Z","submitted_at":"2025-08-10T08:59:32Z","title":"Consistent and Controllable Image Animation with Motion Linear Diffusion Transformers","version":1},"reference_index":38,"source":"pdf_text","source_observed_at":"2026-08-05T22:21:05.375564Z"},"links":{"citing_paper":"/paper/2508.07246"},"observation_digest":"sha256:eb19072eb10541f4320f01c68ff5e5b740212388d2b306eb754512578454b812","observation_id":"095abae5-83ef-4581-af1a-c0fc29730c18","resolution":{"observed_at":"2026-08-05T22:21:05.375564Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T22:21:05.379585Z","title":"Denoising diffusion probabilistic models,","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2508.07246","last_updated":"2025-08-10T08:59:32Z","snapshot_observed_at":"2026-08-09T17:42:18.989378Z","submitted_at":"2025-08-10T08:59:32Z","title":"Consistent and Controllable Image Animation with Motion Linear Diffusion Transformers","version":1},"reference_index":39,"source":"pdf_text","source_observed_at":"2026-08-05T22:21:05.379585Z"},"links":{"citing_paper":"/paper/2508.07246"},"observation_digest":"sha256:675b6d6b7acf3befdd529b751adf656f054a756b5758872a6ec52ab82ac9d245","observation_id":"a4b58b27-9fbd-4a7f-b499-67015839ea80","resolution":{"observed_at":"2026-08-05T22:21:05.379585Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T22:21:05.383507Z","title":"Denoising diffusion implicit mod- els,","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2508.07246","last_updated":"2025-08-10T08:59:32Z","snapshot_observed_at":"2026-08-09T17:42:18.989378Z","submitted_at":"2025-08-10T08:59:32Z","title":"Consistent and Controllable Image Animation with Motion Linear Diffusion Transformers","version":1},"reference_index":40,"source":"pdf_text","source_observed_at":"2026-08-05T22:21:05.383507Z"},"links":{"citing_paper":"/paper/2508.07246"},"observation_digest":"sha256:0f9c88126e3a30d4086e7a3ac7ddea0a44ce603b78f343215ff7c605b807bdce","observation_id":"30503346-3275-4560-8fb7-dd6e62af9cf9","resolution":{"observed_at":"2026-08-05T22:21:05.383507Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T22:21:05.387725Z","title":"Score-based generative modeling through stochastic differential equations,","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2508.07246","last_updated":"2025-08-10T08:59:32Z","snapshot_observed_at":"2026-08-09T17:42:18.989378Z","submitted_at":"2025-08-10T08:59:32Z","title":"Consistent and Controllable Image Animation with Motion Linear Diffusion Transformers","version":1},"reference_index":41,"source":"pdf_text","source_observed_at":"2026-08-05T22:21:05.387725Z"},"links":{"citing_paper":"/paper/2508.07246"},"observation_digest":"sha256:8c38a083befe691023f83ca48da780266b6240ce4f9f46b681da74f9e27fe22d","observation_id":"abfceabe-7197-4ea0-8c6e-05bbde5638bc","resolution":{"observed_at":"2026-08-05T22:21:05.387725Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T22:21:05.391627Z","title":"Scaling rectified flow transformers for high-resolution image synthesis,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2508.07246","last_updated":"2025-08-10T08:59:32Z","snapshot_observed_at":"2026-08-09T17:42:18.989378Z","submitted_at":"2025-08-10T08:59:32Z","title":"Consistent and Controllable Image Animation with Motion Linear Diffusion Transformers","version":1},"reference_index":42,"source":"pdf_text","source_observed_at":"2026-08-05T22:21:05.391627Z"},"links":{"citing_paper":"/paper/2508.07246"},"observation_digest":"sha256:3acc670846d9170bbebc32e5cae52eb636d625753296265a302fe641e752862c","observation_id":"2678fc99-1a15-49eb-a422-4a45724e9dc9","resolution":{"observed_at":"2026-08-05T22:21:05.391627Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T22:21:05.395914Z","title":"Flow matching for generative modeling,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2508.07246","last_updated":"2025-08-10T08:59:32Z","snapshot_observed_at":"2026-08-09T17:42:18.989378Z","submitted_at":"2025-08-10T08:59:32Z","title":"Consistent and Controllable Image Animation with Motion Linear Diffusion Transformers","version":1},"reference_index":43,"source":"pdf_text","source_observed_at":"2026-08-05T22:21:05.395914Z"},"links":{"citing_paper":"/paper/2508.07246"},"observation_digest":"sha256:82a91913cd899e97ae2d7cb2fce3f847bcdbe87092c3bca8bfbb9395760c5bac","observation_id":"ac6dedbb-9fb6-4777-8230-3e3306116874","resolution":{"observed_at":"2026-08-05T22:21:05.395914Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T22:21:05.399981Z","title":"Zero-shot text-to-image generation,","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2508.07246","last_updated":"2025-08-10T08:59:32Z","snapshot_observed_at":"2026-08-09T17:42:18.989378Z","submitted_at":"2025-08-10T08:59:32Z","title":"Consistent and Controllable Image Animation with Motion Linear Diffusion Transformers","version":1},"reference_index":44,"source":"pdf_text","source_observed_at":"2026-08-05T22:21:05.399981Z"},"links":{"citing_paper":"/paper/2508.07246"},"observation_digest":"sha256:2613720303d2d3dad6aa3a3003f68cc4ce7b2fe788843841c5a6bcc49596a0ea","observation_id":"a5fddd56-e323-4e0f-9017-68529cf7a717","resolution":{"observed_at":"2026-08-05T22:21:05.399981Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T22:21:05.403829Z","title":"Photorealistic text-to-image diffusion models with deep language understanding,","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2508.07246","last_updated":"2025-08-10T08:59:32Z","snapshot_observed_at":"2026-08-09T17:42:18.989378Z","submitted_at":"2025-08-10T08:59:32Z","title":"Consistent and Controllable Image Animation with Motion Linear Diffusion Transformers","version":1},"reference_index":45,"source":"pdf_text","source_observed_at":"2026-08-05T22:21:05.403829Z"},"links":{"citing_paper":"/paper/2508.07246"},"observation_digest":"sha256:b58cbb0c29c47a734d6e4f22cb17257c15cfd32c10672972ae4c1da55a7fc4a1","observation_id":"4c6028b9-e4c0-4833-9083-6919013acb46","resolution":{"observed_at":"2026-08-05T22:21:05.403829Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T22:21:05.407827Z","title":"Scaling autoregressive models for content-rich text-to-image generation,","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2508.07246","last_updated":"2025-08-10T08:59:32Z","snapshot_observed_at":"2026-08-09T17:42:18.989378Z","submitted_at":"2025-08-10T08:59:32Z","title":"Consistent and Controllable Image Animation with Motion Linear Diffusion Transformers","version":1},"reference_index":46,"source":"pdf_text","source_observed_at":"2026-08-05T22:21:05.407827Z"},"links":{"citing_paper":"/paper/2508.07246"},"observation_digest":"sha256:dddbab400e89f9b7f6f2ab18986fe67d84755729a01e80f3aede08338b64be9e","observation_id":"3fa2894f-dbc7-474b-8dea-dfb2062e21dd","resolution":{"observed_at":"2026-08-05T22:21:05.407827Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2204.06125","last_updated":"2022-04-13T01:10:33Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2022-04-13T01:10:33Z","title":"Hierarchical Text-Conditional Image Generation with CLIP Latents","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2204.06125","snapshot_observed_at":"2026-08-05T22:21:05.411707Z","title":"Hierarchi- cal text-conditional image generation with clip latents,","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2508.07246","last_updated":"2025-08-10T08:59:32Z","snapshot_observed_at":"2026-08-09T17:42:18.989378Z","submitted_at":"2025-08-10T08:59:32Z","title":"Consistent and Controllable Image Animation with Motion Linear Diffusion Transformers","version":1},"reference_index":47,"source":"pdf_text","source_observed_at":"2026-08-05T22:21:05.411707Z"},"links":{"cited_paper":"/paper/2204.06125","citing_paper":"/paper/2508.07246"},"observation_digest":"sha256:98e8e97f14f8b9851229d169b417b24649573d29fee7b7196e8e49fc0638d1e5","observation_id":"1099b97a-c948-4ebd-be38-4e3127c02651","resolution":{"observed_at":"2026-08-05T22:21:05.411707Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T22:21:05.416037Z","title":"Visual autoregres- sive modeling: Scalable image generation via next-scale prediction,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2508.07246","last_updated":"2025-08-10T08:59:32Z","snapshot_observed_at":"2026-08-09T17:42:18.989378Z","submitted_at":"2025-08-10T08:59:32Z","title":"Consistent and Controllable Image Animation with Motion Linear Diffusion Transformers","version":1},"reference_index":48,"source":"pdf_text","source_observed_at":"2026-08-05T22:21:05.416037Z"},"links":{"citing_paper":"/paper/2508.07246"},"observation_digest":"sha256:7931cb5ce6537bfa5c7d1395c6415732c030e331f1f796ad5f07da09368f7804","observation_id":"b64f09d8-f801-4108-aaef-c4352755ab96","resolution":{"observed_at":"2026-08-05T22:21:05.416037Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T22:21:05.419893Z","title":"Infinity: Scaling bitwise autoregressive modeling for high-resolution image synthesis,","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2508.07246","last_updated":"2025-08-10T08:59:32Z","snapshot_observed_at":"2026-08-09T17:42:18.989378Z","submitted_at":"2025-08-10T08:59:32Z","title":"Consistent and Controllable Image Animation with Motion Linear Diffusion Transformers","version":1},"reference_index":49,"source":"pdf_text","source_observed_at":"2026-08-05T22:21:05.419893Z"},"links":{"citing_paper":"/paper/2508.07246"},"observation_digest":"sha256:dac9e147e9f037e9503eeb912b077d33cd951b6a94439a5d1181dcd4cc291f09","observation_id":"fe460cd0-c63a-448f-a8a3-eb2e7ffa6c34","resolution":{"observed_at":"2026-08-05T22:21:05.419893Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2505.19063","last_updated":"2025-05-27T09:13:49Z","snapshot_observed_at":"2026-08-08T06:45:38.384450Z","submitted_at":"2025-05-25T09:38:23Z","title":"Training-free Stylized Text-to-Image Generation with Fast Inference","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2505.19063","snapshot_observed_at":"2026-08-05T22:21:05.423700Z","title":"Training-free stylized text-to-image generation with fast inference,","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2508.07246","last_updated":"2025-08-10T08:59:32Z","snapshot_observed_at":"2026-08-09T17:42:18.989378Z","submitted_at":"2025-08-10T08:59:32Z","title":"Consistent and Controllable Image Animation with Motion Linear Diffusion Transformers","version":1},"reference_index":50,"source":"pdf_text","source_observed_at":"2026-08-05T22:21:05.423700Z"},"links":{"cited_paper":"/paper/2505.19063","citing_paper":"/paper/2508.07246"},"observation_digest":"sha256:bd6ab31e15e7e7e39c9d20c1da4bbcbb5cd7fa62e8ad19307dce9af270f45c0c","observation_id":"4bfba77e-cec2-4f6b-a7a7-5af7e1515ffd","resolution":{"observed_at":"2026-08-05T22:21:05.423700Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T22:21:05.428153Z","title":"Tune-a-video: One-shot tuning of image diffusion models for text-to-video generation,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2508.07246","last_updated":"2025-08-10T08:59:32Z","snapshot_observed_at":"2026-08-09T17:42:18.989378Z","submitted_at":"2025-08-10T08:59:32Z","title":"Consistent and Controllable Image Animation with Motion Linear Diffusion Transformers","version":1},"reference_index":51,"source":"pdf_text","source_observed_at":"2026-08-05T22:21:05.428153Z"},"links":{"citing_paper":"/paper/2508.07246"},"observation_digest":"sha256:3926effb652dcd5f607a21cb50736c66f07ea4c8881bdb5fc038dcb292c86d3d","observation_id":"be748e11-da85-43c8-b0b7-3f38c2eae2e3","resolution":{"observed_at":"2026-08-05T22:21:05.428153Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T22:21:05.431918Z","title":"Preserve your own correlation: A noise prior for video diffusion models,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2508.07246","last_updated":"2025-08-10T08:59:32Z","snapshot_observed_at":"2026-08-09T17:42:18.989378Z","submitted_at":"2025-08-10T08:59:32Z","title":"Consistent and Controllable Image Animation with Motion Linear Diffusion Transformers","version":1},"reference_index":52,"source":"pdf_text","source_observed_at":"2026-08-05T22:21:05.431918Z"},"links":{"citing_paper":"/paper/2508.07246"},"observation_digest":"sha256:5ac486317798497a70195ac9f43dc8ae716b7aee7dd199db1a5646def2622d7c","observation_id":"2449efef-8069-4c69-9568-84a42ec465cd","resolution":{"observed_at":"2026-08-05T22:21:05.431918Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2211.11018","last_updated":"2023-05-11T11:23:03Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2022-11-20T16:40:31Z","title":"MagicVideo: Efficient Video Generation With Latent Diffusion Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2211.11018","snapshot_observed_at":"2026-08-05T22:21:05.435853Z","title":"Magicvideo: Efficient video generation with latent diffusion models,","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2508.07246","last_updated":"2025-08-10T08:59:32Z","snapshot_observed_at":"2026-08-09T17:42:18.989378Z","submitted_at":"2025-08-10T08:59:32Z","title":"Consistent and Controllable Image Animation with Motion Linear Diffusion Transformers","version":1},"reference_index":53,"source":"pdf_text","source_observed_at":"2026-08-05T22:21:05.435853Z"},"links":{"cited_paper":"/paper/2211.11018","citing_paper":"/paper/2508.07246"},"observation_digest":"sha256:07b16a068f162a37982fa13d619f51f711dc2650d9189f56de2090e99fc33b67","observation_id":"79cb68e7-395e-48aa-bc9b-f3a208e090a9","resolution":{"observed_at":"2026-08-05T22:21:05.435853Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2211.13221","last_updated":"2023-03-20T17:29:45Z","snapshot_observed_at":"2026-08-10T00:51:42.114461Z","submitted_at":"2022-11-23T18:58:39Z","title":"Latent Video Diffusion Models for High-Fidelity Long Video Generation","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2211.13221","snapshot_observed_at":"2026-08-05T22:21:05.440842Z","title":"Latent video dif- fusion models for high-fidelity long video generation,","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2508.07246","last_updated":"2025-08-10T08:59:32Z","snapshot_observed_at":"2026-08-09T17:42:18.989378Z","submitted_at":"2025-08-10T08:59:32Z","title":"Consistent and Controllable Image Animation with Motion Linear Diffusion Transformers","version":1},"reference_index":54,"source":"pdf_text","source_observed_at":"2026-08-05T22:21:05.440842Z"},"links":{"cited_paper":"/paper/2211.13221","citing_paper":"/paper/2508.07246"},"observation_digest":"sha256:8be20d075901d6fb367e5d8881447ce6661e51024ef915bd72719ea419dc0975","observation_id":"35e2fda4-8320-4d20-906f-eacfe60e7240","resolution":{"observed_at":"2026-08-05T22:21:05.440842Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T22:21:05.444835Z","title":"Phenaki: Variable length video generation from open domain textual descriptions,","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2508.07246","last_updated":"2025-08-10T08:59:32Z","snapshot_observed_at":"2026-08-09T17:42:18.989378Z","submitted_at":"2025-08-10T08:59:32Z","title":"Consistent and Controllable Image Animation with Motion Linear Diffusion Transformers","version":1},"reference_index":55,"source":"pdf_text","source_observed_at":"2026-08-05T22:21:05.444835Z"},"links":{"citing_paper":"/paper/2508.07246"},"observation_digest":"sha256:c2a3252600ff648624f2e1256cad4442139c6f9121489eb837c60de6d37b5a58","observation_id":"d19b4f12-9aa6-4f2d-86d2-500a8db34d29","resolution":{"observed_at":"2026-08-05T22:21:05.444835Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2410.13720","last_updated":"2025-02-26T16:05:55Z","snapshot_observed_at":"2026-08-09T03:17:30.671491Z","submitted_at":"2024-10-17T16:22:46Z","title":"Movie Gen: A Cast of Media Foundation Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2410.13720","snapshot_observed_at":"2026-08-05T22:21:05.448579Z","title":"Movie gen: A cast of media foun- dation models, 2025,","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2508.07246","last_updated":"2025-08-10T08:59:32Z","snapshot_observed_at":"2026-08-09T17:42:18.989378Z","submitted_at":"2025-08-10T08:59:32Z","title":"Consistent and Controllable Image Animation with Motion Linear Diffusion Transformers","version":1},"reference_index":56,"source":"pdf_text","source_observed_at":"2026-08-05T22:21:05.448579Z"},"links":{"cited_paper":"/paper/2410.13720","citing_paper":"/paper/2508.07246"},"observation_digest":"sha256:84b9050b31c17272ae0d3b08cf2cd964d2217a0d1ba0d99eec687f3e8e7a8e84","observation_id":"086c64f7-92df-4dcc-8745-cc9d75bdf4b7","resolution":{"observed_at":"2026-08-05T22:21:05.448579Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T22:21:05.452681Z","title":"Autoregressive video generation without vector quantiza- tion,","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2508.07246","last_updated":"2025-08-10T08:59:32Z","snapshot_observed_at":"2026-08-09T17:42:18.989378Z","submitted_at":"2025-08-10T08:59:32Z","title":"Consistent and Controllable Image Animation with Motion Linear Diffusion Transformers","version":1},"reference_index":57,"source":"pdf_text","source_observed_at":"2026-08-05T22:21:05.452681Z"},"links":{"citing_paper":"/paper/2508.07246"},"observation_digest":"sha256:dd7d8e3711f64ebcaa459e65e284bb3ef3d06781255ff20c72eea957ed8d97dc","observation_id":"15d53944-b766-4024-8aae-566bad4d8937","resolution":{"observed_at":"2026-08-05T22:21:05.452681Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T22:21:06.810587Z","title":"Pyramidal flow matching for efficient video generative modeling,","venue":null,"work_id":"814ceefe-177c-44dd-9e73-7b1956790982","year":2025},"citing_paper":{"arxiv_id":"2508.07246","last_updated":"2025-08-10T08:59:32Z","snapshot_observed_at":"2026-08-09T17:42:18.989378Z","submitted_at":"2025-08-10T08:59:32Z","title":"Consistent and Controllable Image Animation with Motion Linear Diffusion Transformers","version":1},"reference_index":58,"source":"pdf_text","source_observed_at":"2026-08-05T22:21:05.456892Z"},"links":{"citing_paper":"/paper/2508.07246"},"observation_digest":"sha256:09d4eb937f75a6b237cc57dde86c845b5777d9369b296d3c728a8bcf4fa6c364","observation_id":"01e256d7-e061-42ff-9fcc-77323f50fd39","resolution":{"observed_at":"2026-08-05T22:21:06.814740Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T22:21:06.797418Z","title":"Spatial- temporal graph mamba for music-guided dance video synthesis,","venue":null,"work_id":"939f55f5-1469-4760-9d1c-de5257ac8cfd","year":2025},"citing_paper":{"arxiv_id":"2508.07246","last_updated":"2025-08-10T08:59:32Z","snapshot_observed_at":"2026-08-09T17:42:18.989378Z","submitted_at":"2025-08-10T08:59:32Z","title":"Consistent and Controllable Image Animation with Motion Linear Diffusion Transformers","version":1},"reference_index":59,"source":"pdf_text","source_observed_at":"2026-08-05T22:21:05.462065Z"},"links":{"citing_paper":"/paper/2508.07246"},"observation_digest":"sha256:133fa8b5d2fcd3d52b164ce7495601ea7e4dc82a5bfa5c5efb73fd2209d90dc8","observation_id":"bc2a9bbf-8a23-404a-b47c-7ebbca65c4fc","resolution":{"observed_at":"2026-08-05T22:21:06.802105Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T22:21:06.783456Z","title":"Magictime: Time-lapse video generation models as metamorphic simulators,","venue":null,"work_id":"5503b7a8-9e5f-4e83-90ca-0eaecc6ca303","year":2025},"citing_paper":{"arxiv_id":"2508.07246","last_updated":"2025-08-10T08:59:32Z","snapshot_observed_at":"2026-08-09T17:42:18.989378Z","submitted_at":"2025-08-10T08:59:32Z","title":"Consistent and Controllable Image Animation with Motion Linear Diffusion Transformers","version":1},"reference_index":60,"source":"pdf_text","source_observed_at":"2026-08-05T22:21:05.466073Z"},"links":{"citing_paper":"/paper/2508.07246"},"observation_digest":"sha256:a4d61a07497bbff17dbcc3b9ad30545f206001b58926c19bb725977e7e515e1e","observation_id":"5fe5dcc6-d076-469e-b5f9-98c75735fa96","resolution":{"observed_at":"2026-08-05T22:21:06.788623Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T22:21:06.770407Z","title":"Cascaded dynamic memory refinement and semantic alignment for exo-to-ego cross-view video generation,","venue":null,"work_id":"d8276be4-cdc7-49bb-b0fa-210adc621886","year":2025},"citing_paper":{"arxiv_id":"2508.07246","last_updated":"2025-08-10T08:59:32Z","snapshot_observed_at":"2026-08-09T17:42:18.989378Z","submitted_at":"2025-08-10T08:59:32Z","title":"Consistent and Controllable Image Animation with Motion Linear Diffusion Transformers","version":1},"reference_index":61,"source":"pdf_text","source_observed_at":"2026-08-05T22:21:05.470032Z"},"links":{"citing_paper":"/paper/2508.07246"},"observation_digest":"sha256:745fd271ed0e538c575951d1fb33201f2dbe2a33716b0ed3ac6f9938f958f93f","observation_id":"b1401848-718a-436f-800b-10ac045cd62a","resolution":{"observed_at":"2026-08-05T22:21:06.774684Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T22:21:06.757293Z","title":"Efficient diffusion models: A comprehensive survey from principles to practices,","venue":null,"work_id":"aa5d33b9-9554-405d-a4b4-3be81a3404ef","year":2025},"citing_paper":{"arxiv_id":"2508.07246","last_updated":"2025-08-10T08:59:32Z","snapshot_observed_at":"2026-08-09T17:42:18.989378Z","submitted_at":"2025-08-10T08:59:32Z","title":"Consistent and Controllable Image Animation with Motion Linear Diffusion Transformers","version":1},"reference_index":62,"source":"pdf_text","source_observed_at":"2026-08-05T22:21:05.473894Z"},"links":{"citing_paper":"/paper/2508.07246"},"observation_digest":"sha256:e5efba2a26df7b7c9776fb2cc07d86a05e85bf2ae551999a96325692886c257b","observation_id":"719be485-6d6f-41cc-b121-c7a03d18ab47","resolution":{"observed_at":"2026-08-05T22:21:06.761705Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T22:21:06.744468Z","title":"Video diffusion models,","venue":null,"work_id":"80aefaba-e4e6-4027-b187-627980e4a197","year":2022},"citing_paper":{"arxiv_id":"2508.07246","last_updated":"2025-08-10T08:59:32Z","snapshot_observed_at":"2026-08-09T17:42:18.989378Z","submitted_at":"2025-08-10T08:59:32Z","title":"Consistent and Controllable Image Animation with Motion Linear Diffusion Transformers","version":1},"reference_index":63,"source":"pdf_text","source_observed_at":"2026-08-05T22:21:05.477941Z"},"links":{"citing_paper":"/paper/2508.07246"},"observation_digest":"sha256:2b4fe3765a6990f198c1f3e622892dac081adc84363e430d06d36dff227e9550","observation_id":"09bd68f2-7f05-4a60-b97f-65c41efb856b","resolution":{"observed_at":"2026-08-05T22:21:06.748442Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2210.02303","last_updated":"2022-10-05T14:41:38Z","snapshot_observed_at":"2026-07-06T13:59:57.800591Z","submitted_at":"2022-10-05T14:41:38Z","title":"Imagen Video: High Definition Video Generation with Diffusion Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2210.02303","snapshot_observed_at":"2026-08-05T22:21:05.481762Z","title":"Imagen video: High definition video generation with diffusion models,","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2508.07246","last_updated":"2025-08-10T08:59:32Z","snapshot_observed_at":"2026-08-09T17:42:18.989378Z","submitted_at":"2025-08-10T08:59:32Z","title":"Consistent and Controllable Image Animation with Motion Linear Diffusion Transformers","version":1},"reference_index":64,"source":"pdf_text","source_observed_at":"2026-08-05T22:21:05.481762Z"},"links":{"cited_paper":"/paper/2210.02303","citing_paper":"/paper/2508.07246"},"observation_digest":"sha256:9ab3f76121cb7775f90090c8180d590c28dc75f95cccf72f7f6f82684b3a5c35","observation_id":"9b43958a-4114-45d5-bfac-c0013fd62ddf","resolution":{"observed_at":"2026-08-05T22:21:05.481762Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T22:21:06.731686Z","title":"Cascaded diffusion models for high fidelity image generation,","venue":null,"work_id":"bf408c5f-bc9f-4e23-91be-89d73e93263b","year":2022},"citing_paper":{"arxiv_id":"2508.07246","last_updated":"2025-08-10T08:59:32Z","snapshot_observed_at":"2026-08-09T17:42:18.989378Z","submitted_at":"2025-08-10T08:59:32Z","title":"Consistent and Controllable Image Animation with Motion Linear Diffusion Transformers","version":1},"reference_index":65,"source":"pdf_text","source_observed_at":"2026-08-05T22:21:05.486147Z"},"links":{"citing_paper":"/paper/2508.07246"},"observation_digest":"sha256:dbef4087d7352a70f9d5efdc988b0eeef5e390ed4dfb4a16f5bb41efa78bf647","observation_id":"bf7c9c87-8820-4ee4-be82-d4fcf4a2bf9c","resolution":{"observed_at":"2026-08-05T22:21:06.735841Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2311.15127","last_updated":"2023-11-25T22:28:38Z","snapshot_observed_at":"2026-08-07T21:47:08.589400Z","submitted_at":"2023-11-25T22:28:38Z","title":"Stable Video Diffusion: Scaling Latent Video Diffusion Models to Large Datasets","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2311.15127","snapshot_observed_at":"2026-08-05T22:21:05.490258Z","title":"Stable video diffusion: Scaling latent video diffusion models to large datasets,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2508.07246","last_updated":"2025-08-10T08:59:32Z","snapshot_observed_at":"2026-08-09T17:42:18.989378Z","submitted_at":"2025-08-10T08:59:32Z","title":"Consistent and Controllable Image Animation with Motion Linear Diffusion Transformers","version":1},"reference_index":66,"source":"pdf_text","source_observed_at":"2026-08-05T22:21:05.490258Z"},"links":{"cited_paper":"/paper/2311.15127","citing_paper":"/paper/2508.07246"},"observation_digest":"sha256:727cd39ffd50219f6aa1470ac61126bb11be81dba557c41891f280931550c867","observation_id":"ccb677dc-6e7d-4b29-8aa8-7690976a561c","resolution":{"observed_at":"2026-08-05T22:21:05.490258Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T22:21:06.719033Z","title":"Automatic animation of hair blowing in still portrait photos,","venue":null,"work_id":"4dbefb7c-ce87-4497-8609-fe737eea425e","year":2023},"citing_paper":{"arxiv_id":"2508.07246","last_updated":"2025-08-10T08:59:32Z","snapshot_observed_at":"2026-08-09T17:42:18.989378Z","submitted_at":"2025-08-10T08:59:32Z","title":"Consistent and Controllable Image Animation with Motion Linear Diffusion Transformers","version":1},"reference_index":67,"source":"pdf_text","source_observed_at":"2026-08-05T22:21:05.495106Z"},"links":{"citing_paper":"/paper/2508.07246"},"observation_digest":"sha256:fc3041e57636d56963aa13b8d596346d144b076953dd28de559cc72de6dd487e","observation_id":"db12de8c-e13b-40a4-b0fe-ca3934d35ba4","resolution":{"observed_at":"2026-08-05T22:21:06.723066Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T22:21:06.705207Z","title":"Warp-guided gans for single-photo facial animation,","venue":null,"work_id":"cd2a7d18-62ff-48a5-a250-77d14803f5b0","year":2018},"citing_paper":{"arxiv_id":"2508.07246","last_updated":"2025-08-10T08:59:32Z","snapshot_observed_at":"2026-08-09T17:42:18.989378Z","submitted_at":"2025-08-10T08:59:32Z","title":"Consistent and Controllable Image Animation with Motion Linear Diffusion Transformers","version":1},"reference_index":68,"source":"pdf_text","source_observed_at":"2026-08-05T22:21:05.499192Z"},"links":{"citing_paper":"/paper/2508.07246"},"observation_digest":"sha256:8629a98ecf5e3b4cf596aeb5f851ad76118323f6dfeddaee3f3324bd304cfc5d","observation_id":"782bf737-e608-4e4e-9a55-26eb91ef2067","resolution":{"observed_at":"2026-08-05T22:21:06.710329Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T22:21:06.692104Z","title":"Imaginator: Conditional spatio-temporal gan for video generation,","venue":null,"work_id":"688c98eb-7ee5-4084-af9a-2a60f6e1c81c","year":2020},"citing_paper":{"arxiv_id":"2508.07246","last_updated":"2025-08-10T08:59:32Z","snapshot_observed_at":"2026-08-09T17:42:18.989378Z","submitted_at":"2025-08-10T08:59:32Z","title":"Consistent and Controllable Image Animation with Motion Linear Diffusion Transformers","version":1},"reference_index":69,"source":"pdf_text","source_observed_at":"2026-08-05T22:21:05.503434Z"},"links":{"citing_paper":"/paper/2508.07246"},"observation_digest":"sha256:8f85112d934fd5176ec6264d9121a94d31e186a6b9e56b6134bb1fcf9cdd5a62","observation_id":"85275f8d-006c-40e0-bfdd-2c6cba3711e7","resolution":{"observed_at":"2026-08-05T22:21:06.696739Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T22:21:06.677809Z","title":"Latent image animator: Learning to animate images via latent space navigation,","venue":null,"work_id":"bd76829b-f4ab-44c4-bca5-5e6ce3041c53","year":2022},"citing_paper":{"arxiv_id":"2508.07246","last_updated":"2025-08-10T08:59:32Z","snapshot_observed_at":"2026-08-09T17:42:18.989378Z","submitted_at":"2025-08-10T08:59:32Z","title":"Consistent and Controllable Image Animation with Motion Linear Diffusion Transformers","version":1},"reference_index":70,"source":"pdf_text","source_observed_at":"2026-08-05T22:21:05.507670Z"},"links":{"citing_paper":"/paper/2508.07246"},"observation_digest":"sha256:9ab6368a81d0fc9fb35e99798f6cf28a6c885a12f31451143e35439f1319daf2","observation_id":"c4a86919-538c-4930-82a2-f34628a867aa","resolution":{"observed_at":"2026-08-05T22:21:06.682951Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T22:21:06.664719Z","title":"Hallo3: Highly dynamic and realistic portrait image animation with video diffusion transformer,","venue":null,"work_id":"1ca5c2e4-267f-4eae-8318-df67eab69dd5","year":2025},"citing_paper":{"arxiv_id":"2508.07246","last_updated":"2025-08-10T08:59:32Z","snapshot_observed_at":"2026-08-09T17:42:18.989378Z","submitted_at":"2025-08-10T08:59:32Z","title":"Consistent and Controllable Image Animation with Motion Linear Diffusion Transformers","version":1},"reference_index":71,"source":"pdf_text","source_observed_at":"2026-08-05T22:21:05.511773Z"},"links":{"citing_paper":"/paper/2508.07246"},"observation_digest":"sha256:2f2aa531f3ada9f7205e6b83dfffbae1c91f18f56379f61e7e8c983b13707f62","observation_id":"e500bc51-521c-432c-a3c6-c1d01dccaa73","resolution":{"observed_at":"2026-08-05T22:21:06.669105Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T22:21:06.652238Z","title":"Zero-1-to-a: Zero-shot one image to animatable head avatars using video diffusion,","venue":null,"work_id":"68a38b92-edb3-4796-81f1-8e5e91e25584","year":2025},"citing_paper":{"arxiv_id":"2508.07246","last_updated":"2025-08-10T08:59:32Z","snapshot_observed_at":"2026-08-09T17:42:18.989378Z","submitted_at":"2025-08-10T08:59:32Z","title":"Consistent and Controllable Image Animation with Motion Linear Diffusion Transformers","version":1},"reference_index":72,"source":"pdf_text","source_observed_at":"2026-08-05T22:21:05.515836Z"},"links":{"citing_paper":"/paper/2508.07246"},"observation_digest":"sha256:bfeb1b78eb7b7821728e4bb278fb5b9248a3ea5541e2609465517ae1fadd3d91","observation_id":"e9153c9e-d9bb-4df2-a69b-967113f23f8f","resolution":{"observed_at":"2026-08-05T22:21:06.656379Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T22:21:06.639294Z","title":"Blowing in the wind: Cyclenet for human cinemagraphs from still images,","venue":null,"work_id":"5d648beb-ec79-41e1-9930-b779f9352de6","year":2023},"citing_paper":{"arxiv_id":"2508.07246","last_updated":"2025-08-10T08:59:32Z","snapshot_observed_at":"2026-08-09T17:42:18.989378Z","submitted_at":"2025-08-10T08:59:32Z","title":"Consistent and Controllable Image Animation with Motion Linear Diffusion Transformers","version":1},"reference_index":73,"source":"pdf_text","source_observed_at":"2026-08-05T22:21:05.519712Z"},"links":{"citing_paper":"/paper/2508.07246"},"observation_digest":"sha256:72153f91f810fe1da663573b0acee4d418b5bca6edce8e878a1ad29095d75ed1","observation_id":"e7a53e3b-72dd-46f3-94ba-f2dcee8acc03","resolution":{"observed_at":"2026-08-05T22:21:06.643566Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T22:21:06.626668Z","title":"Under- standing object dynamics for interactive image-to-video synthesis,","venue":null,"work_id":"66bc4864-d184-4c6e-b577-4ba51c5a01fb","year":2021},"citing_paper":{"arxiv_id":"2508.07246","last_updated":"2025-08-10T08:59:32Z","snapshot_observed_at":"2026-08-09T17:42:18.989378Z","submitted_at":"2025-08-10T08:59:32Z","title":"Consistent and Controllable Image Animation with Motion Linear Diffusion Transformers","version":1},"reference_index":74,"source":"pdf_text","source_observed_at":"2026-08-05T22:21:05.523508Z"},"links":{"citing_paper":"/paper/2508.07246"},"observation_digest":"sha256:224508faf8b109832d2c2f522d4ffdd3a40bd2ad7347b25520319dc3e41c14e3","observation_id":"1ea63205-c1dc-40a8-99f8-5770e72dadde","resolution":{"observed_at":"2026-08-05T22:21:06.630979Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T22:21:06.613760Z","title":"Motion representations for articulated animation,","venue":null,"work_id":"297379db-7a7a-4708-9cf1-a3e492c34471","year":2021},"citing_paper":{"arxiv_id":"2508.07246","last_updated":"2025-08-10T08:59:32Z","snapshot_observed_at":"2026-08-09T17:42:18.989378Z","submitted_at":"2025-08-10T08:59:32Z","title":"Consistent and Controllable Image Animation with Motion Linear Diffusion Transformers","version":1},"reference_index":75,"source":"pdf_text","source_observed_at":"2026-08-05T22:21:05.527643Z"},"links":{"citing_paper":"/paper/2508.07246"},"observation_digest":"sha256:47ac11a6984e5499b626e416bb5b223effafc02b53bf5eef4f45d875aaded4cc","observation_id":"75a8db15-e56d-44a1-8a41-926b9d65727c","resolution":{"observed_at":"2026-08-05T22:21:06.617995Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T22:21:06.600924Z","title":"Leo: Generative latent image animator for human video synthesis,","venue":null,"work_id":"bc3b5c06-dd41-4dbd-b2d0-056d12eef120","year":2024},"citing_paper":{"arxiv_id":"2508.07246","last_updated":"2025-08-10T08:59:32Z","snapshot_observed_at":"2026-08-09T17:42:18.989378Z","submitted_at":"2025-08-10T08:59:32Z","title":"Consistent and Controllable Image Animation with Motion Linear Diffusion Transformers","version":1},"reference_index":76,"source":"pdf_text","source_observed_at":"2026-08-05T22:21:05.531501Z"},"links":{"citing_paper":"/paper/2508.07246"},"observation_digest":"sha256:4846ede53c1ebb71132e3f75ed5439ba4c32403e3fb3d6da5a1a5cea7c8ceb2f","observation_id":"62436a33-bdc4-4c97-8e29-d447c723da13","resolution":{"observed_at":"2026-08-05T22:21:06.605158Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T22:21:06.588532Z","title":"Lia: Latent image animator,","venue":null,"work_id":"1a6934b6-7db0-4dd8-bdfb-1f3e81e0592f","year":2024},"citing_paper":{"arxiv_id":"2508.07246","last_updated":"2025-08-10T08:59:32Z","snapshot_observed_at":"2026-08-09T17:42:18.989378Z","submitted_at":"2025-08-10T08:59:32Z","title":"Consistent and Controllable Image Animation with Motion Linear Diffusion Transformers","version":1},"reference_index":77,"source":"pdf_text","source_observed_at":"2026-08-05T22:21:05.535764Z"},"links":{"citing_paper":"/paper/2508.07246"},"observation_digest":"sha256:ffb61ad00a2776284c8f29c87d5274f74992127242290f77d2eb38960a542eb3","observation_id":"3dafcbe9-f923-41d4-b558-4b965174794d","resolution":{"observed_at":"2026-08-05T22:21:06.592500Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T22:21:06.575270Z","title":"Stableanimator: High-quality identity-preserving human image anima- tion,","venue":null,"work_id":"9b311d61-bdc5-4bbe-9dc1-5a9abaa5e171","year":2025},"citing_paper":{"arxiv_id":"2508.07246","last_updated":"2025-08-10T08:59:32Z","snapshot_observed_at":"2026-08-09T17:42:18.989378Z","submitted_at":"2025-08-10T08:59:32Z","title":"Consistent and Controllable Image Animation with Motion Linear Diffusion Transformers","version":1},"reference_index":78,"source":"pdf_text","source_observed_at":"2026-08-05T22:21:05.539623Z"},"links":{"citing_paper":"/paper/2508.07246"},"observation_digest":"sha256:6fa000e6f5589fd497b81c7a253c526e2a2a790c87d7c2f907e66583922625ba","observation_id":"219c62e7-6f4e-402f-ac35-c68415460d09","resolution":{"observed_at":"2026-08-05T22:21:06.579637Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T22:21:06.561912Z","title":"X-dyna: Expressive dynamic human image animation,","venue":null,"work_id":"34ccfcce-0faf-4c6d-9eff-d3cde8b75960","year":2025},"citing_paper":{"arxiv_id":"2508.07246","last_updated":"2025-08-10T08:59:32Z","snapshot_observed_at":"2026-08-09T17:42:18.989378Z","submitted_at":"2025-08-10T08:59:32Z","title":"Consistent and Controllable Image Animation with Motion Linear Diffusion Transformers","version":1},"reference_index":79,"source":"pdf_text","source_observed_at":"2026-08-05T22:21:05.543491Z"},"links":{"citing_paper":"/paper/2508.07246"},"observation_digest":"sha256:571357de1ad47b38d3eb2adbfed3baada990930e4e10d5520cc14017b85784e9","observation_id":"8564ccac-5d65-422e-a6c9-f1da47d74550","resolution":{"observed_at":"2026-08-05T22:21:06.566194Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T22:21:06.548052Z","title":"Animating pictures with stochastic motion textures,","venue":null,"work_id":"59571858-cedd-4d24-8af0-ba61160c1b7b","year":2005},"citing_paper":{"arxiv_id":"2508.07246","last_updated":"2025-08-10T08:59:32Z","snapshot_observed_at":"2026-08-09T17:42:18.989378Z","submitted_at":"2025-08-10T08:59:32Z","title":"Consistent and Controllable Image Animation with Motion Linear Diffusion Transformers","version":1},"reference_index":80,"source":"pdf_text","source_observed_at":"2026-08-05T22:21:05.547633Z"},"links":{"citing_paper":"/paper/2508.07246"},"observation_digest":"sha256:055d2911eea8608e3539d293d90680d90e72ebdf7b21a18552a100b6a3dbbb14","observation_id":"7f1cc782-871e-4771-8651-31331428d054","resolution":{"observed_at":"2026-08-05T22:21:06.553025Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T22:21:06.535381Z","title":"Animating animal motion from still,","venue":null,"work_id":"2161a200-7969-47c0-b2aa-1e1b0460810f","year":2008},"citing_paper":{"arxiv_id":"2508.07246","last_updated":"2025-08-10T08:59:32Z","snapshot_observed_at":"2026-08-09T17:42:18.989378Z","submitted_at":"2025-08-10T08:59:32Z","title":"Consistent and Controllable Image Animation with Motion Linear Diffusion Transformers","version":1},"reference_index":81,"source":"pdf_text","source_observed_at":"2026-08-05T22:21:05.551586Z"},"links":{"citing_paper":"/paper/2508.07246"},"observation_digest":"sha256:db60b78ed54cf46f2a31b44787dd4eb2d4f055e1af55b14ec9b3505da7e7b6e2","observation_id":"5d75bd85-a91b-43a7-a557-549e348ec3c2","resolution":{"observed_at":"2026-08-05T22:21:06.539421Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T22:21:06.520996Z","title":"Stochastic image-to-video synthesis using cinns,","venue":null,"work_id":"449084e6-b585-4101-9ab7-f916db62e592","year":2021},"citing_paper":{"arxiv_id":"2508.07246","last_updated":"2025-08-10T08:59:32Z","snapshot_observed_at":"2026-08-09T17:42:18.989378Z","submitted_at":"2025-08-10T08:59:32Z","title":"Consistent and Controllable Image Animation with Motion Linear Diffusion Transformers","version":1},"reference_index":82,"source":"pdf_text","source_observed_at":"2026-08-05T22:21:05.555577Z"},"links":{"citing_paper":"/paper/2508.07246"},"observation_digest":"sha256:e07007ffeb7c1e72700fcb1bc4869940b958776b05130489fe9049137bf946d1","observation_id":"9a577650-18b2-43fa-976c-d8dd0cc24aa1","resolution":{"observed_at":"2026-08-05T22:21:06.525834Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T22:21:06.505975Z","title":"A phase-based approach for animating images using video examples,","venue":null,"work_id":"e9967fea-c818-461b-8347-ee95208bce10","year":2017},"citing_paper":{"arxiv_id":"2508.07246","last_updated":"2025-08-10T08:59:32Z","snapshot_observed_at":"2026-08-09T17:42:18.989378Z","submitted_at":"2025-08-10T08:59:32Z","title":"Consistent and Controllable Image Animation with Motion Linear Diffusion Transformers","version":1},"reference_index":83,"source":"pdf_text","source_observed_at":"2026-08-05T22:21:05.559800Z"},"links":{"citing_paper":"/paper/2508.07246"},"observation_digest":"sha256:735ccc71cab70d9e91c397e7c7efa50bc874d19e572fb916f895a71633f56e00","observation_id":"d3b10872-3045-415c-8f59-1b9e0907d024","resolution":{"observed_at":"2026-08-05T22:21:06.510964Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T22:21:06.492031Z","title":"F 3a-gan: Facial flow for face animation with generative adversarial networks,","venue":null,"work_id":"9e6ae55a-3a9e-4bcf-a7f3-9377778fbe36","year":2021},"citing_paper":{"arxiv_id":"2508.07246","last_updated":"2025-08-10T08:59:32Z","snapshot_observed_at":"2026-08-09T17:42:18.989378Z","submitted_at":"2025-08-10T08:59:32Z","title":"Consistent and Controllable Image Animation with Motion Linear Diffusion Transformers","version":1},"reference_index":84,"source":"pdf_text","source_observed_at":"2026-08-05T22:21:05.563776Z"},"links":{"citing_paper":"/paper/2508.07246"},"observation_digest":"sha256:225de5f5972bf0309baf9583cf5013310085ac55abdc8796c3abac909f32b715","observation_id":"655a7f4b-9070-4c03-b5a3-211be37282f7","resolution":{"observed_at":"2026-08-05T22:21:06.496756Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T22:21:06.478602Z","title":"Animegan: A novel lightweight gan for photo animation,","venue":null,"work_id":"7d1d28ef-b9a1-44ec-9fe5-854f6757316d","year":2020},"citing_paper":{"arxiv_id":"2508.07246","last_updated":"2025-08-10T08:59:32Z","snapshot_observed_at":"2026-08-09T17:42:18.989378Z","submitted_at":"2025-08-10T08:59:32Z","title":"Consistent and Controllable Image Animation with Motion Linear Diffusion Transformers","version":1},"reference_index":85,"source":"pdf_text","source_observed_at":"2026-08-05T22:21:05.567595Z"},"links":{"citing_paper":"/paper/2508.07246"},"observation_digest":"sha256:03b15b8a037058c56fab8afbe6e0516d79498fef1944c73ec985542d6cad8c6c","observation_id":"5f1b3504-5d77-4e52-b8a6-39674b7f308a","resolution":{"observed_at":"2026-08-05T22:21:06.483170Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T22:21:06.465348Z","title":"Ganimation: Anatomically-aware facial animation from a single image,","venue":null,"work_id":"21b575e3-37cf-49eb-866a-edac25e0cbc7","year":2018},"citing_paper":{"arxiv_id":"2508.07246","last_updated":"2025-08-10T08:59:32Z","snapshot_observed_at":"2026-08-09T17:42:18.989378Z","submitted_at":"2025-08-10T08:59:32Z","title":"Consistent and Controllable Image Animation with Motion Linear Diffusion Transformers","version":1},"reference_index":86,"source":"pdf_text","source_observed_at":"2026-08-05T22:21:05.571649Z"},"links":{"citing_paper":"/paper/2508.07246"},"observation_digest":"sha256:86a771ca6aa2fd1bbad7046d62a13a91ec7e49a8006a9e452982de6f94db7d4f","observation_id":"7661e158-f94d-4a35-85c2-f55fb41cee7a","resolution":{"observed_at":"2026-08-05T22:21:06.469580Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T22:21:06.451529Z","title":"Videocomposer: Compositional video synthesis with motion controllability,","venue":null,"work_id":"6743c6c2-5a34-4c89-9bd5-84bcae7bb8f0","year":2024},"citing_paper":{"arxiv_id":"2508.07246","last_updated":"2025-08-10T08:59:32Z","snapshot_observed_at":"2026-08-09T17:42:18.989378Z","submitted_at":"2025-08-10T08:59:32Z","title":"Consistent and Controllable Image Animation with Motion Linear Diffusion Transformers","version":1},"reference_index":87,"source":"pdf_text","source_observed_at":"2026-08-05T22:21:05.575754Z"},"links":{"citing_paper":"/paper/2508.07246"},"observation_digest":"sha256:1c9b7db39943ad89abaa1f85db7fb4d35c3fc7808297481e561b4e7fe8587ff7","observation_id":"653c4cd6-5525-45d9-9ff9-6b402f79ae5f","resolution":{"observed_at":"2026-08-05T22:21:06.456368Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2310.19512","last_updated":"2023-10-30T13:12:40Z","snapshot_observed_at":"2026-08-07T10:15:15.859263Z","submitted_at":"2023-10-30T13:12:40Z","title":"VideoCrafter1: Open Diffusion Models for High-Quality Video Generation","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2310.19512","snapshot_observed_at":"2026-08-05T22:21:05.579844Z","title":"Videocrafter1: Open diffusion models for high-quality video generation,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2508.07246","last_updated":"2025-08-10T08:59:32Z","snapshot_observed_at":"2026-08-09T17:42:18.989378Z","submitted_at":"2025-08-10T08:59:32Z","title":"Consistent and Controllable Image Animation with Motion Linear Diffusion Transformers","version":1},"reference_index":88,"source":"pdf_text","source_observed_at":"2026-08-05T22:21:05.579844Z"},"links":{"cited_paper":"/paper/2310.19512","citing_paper":"/paper/2508.07246"},"observation_digest":"sha256:a0e3ca5d45c75ef0b305aac325f80d2aba6a7fcb909689c8e8e2c5296d051c16","observation_id":"67ebeb40-4eb4-4d39-b795-07e016efc5d4","resolution":{"observed_at":"2026-08-05T22:21:05.579844Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T22:21:05.583941Z","title":"Learning transferable visual models from natural language supervision,","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2508.07246","last_updated":"2025-08-10T08:59:32Z","snapshot_observed_at":"2026-08-09T17:42:18.989378Z","submitted_at":"2025-08-10T08:59:32Z","title":"Consistent and Controllable Image Animation with Motion Linear Diffusion Transformers","version":1},"reference_index":89,"source":"pdf_text","source_observed_at":"2026-08-05T22:21:05.583941Z"},"links":{"citing_paper":"/paper/2508.07246"},"observation_digest":"sha256:968e11276ac2776216b81101de9a75100d99c000c9b0a26a59460769cb143028","observation_id":"53347b86-9b3a-4296-838c-e4a77e2c46b6","resolution":{"observed_at":"2026-08-05T22:21:05.583941Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T22:21:06.429854Z","title":"Animatelcm: Accelerating the animation of personalized diffusion models and adapters with decoupled consistency learning,","venue":null,"work_id":"4ca169ae-eb4a-4a97-aee4-369ad42bf109","year":2024},"citing_paper":{"arxiv_id":"2508.07246","last_updated":"2025-08-10T08:59:32Z","snapshot_observed_at":"2026-08-09T17:42:18.989378Z","submitted_at":"2025-08-10T08:59:32Z","title":"Consistent and Controllable Image Animation with Motion Linear Diffusion Transformers","version":1},"reference_index":90,"source":"pdf_text","source_observed_at":"2026-08-05T22:21:05.587973Z"},"links":{"citing_paper":"/paper/2508.07246"},"observation_digest":"sha256:8acd19403c5f9f2d150a54cb76e8ff7166510759856264f246c3f3c4b22576fa","observation_id":"8a62ba12-6031-4662-8ac2-83366b9c9c05","resolution":{"observed_at":"2026-08-05T22:21:06.433979Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2312.03018","last_updated":"2024-09-16T16:02:34Z","snapshot_observed_at":"2026-07-06T16:57:21.997777Z","submitted_at":"2023-12-05T03:16:31Z","title":"DreamVideo: High-Fidelity Image-to-Video Generation with Image Retention and Text Guidance","version":4},"cited_work":{"arxiv_id":"2312.03018","doi":null,"metadata_source":"pith","pith_arxiv_id":"2312.03018","snapshot_observed_at":"2026-08-05T22:21:05.834607Z","title":"DreamVideo: High-Fidelity Image-to-Video Generation with Image Retention and Text Guidance","venue":"cs.CV","work_id":"5e2f3f8a-e9ce-4a18-8496-274d18a02423","year":2023},"citing_paper":{"arxiv_id":"2508.07246","last_updated":"2025-08-10T08:59:32Z","snapshot_observed_at":"2026-08-09T17:42:18.989378Z","submitted_at":"2025-08-10T08:59:32Z","title":"Consistent and Controllable Image Animation with Motion Linear Diffusion Transformers","version":1},"reference_index":91,"source":"pdf_text","source_observed_at":"2026-08-05T22:21:05.592284Z"},"links":{"cited_paper":"/paper/2312.03018","citing_paper":"/paper/2508.07246"},"observation_digest":"sha256:a05d2a8e51c11f40651a4514da08c95871cb3bc778fc4632623d893620a64bfd","observation_id":"76a72fe0-d9d3-43a6-b1d7-fa764a65b42f","resolution":{"observed_at":"2026-08-05T22:21:05.841479Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T22:21:06.416598Z","title":"Vdt: General-purpose video diffusion transformers via mask modeling,","venue":null,"work_id":"753d44ab-aba1-47c8-bdd4-f20e36b4de2b","year":2023},"citing_paper":{"arxiv_id":"2508.07246","last_updated":"2025-08-10T08:59:32Z","snapshot_observed_at":"2026-08-09T17:42:18.989378Z","submitted_at":"2025-08-10T08:59:32Z","title":"Consistent and Controllable Image Animation with Motion Linear Diffusion Transformers","version":1},"reference_index":92,"source":"pdf_text","source_observed_at":"2026-08-05T22:21:05.596374Z"},"links":{"citing_paper":"/paper/2508.07246"},"observation_digest":"sha256:b56a901c9772a849b3d1128d08b4f8deb5e72a780e6b2f14e9a67d0976705d47","observation_id":"92cf6fa4-9fbc-4637-aa69-0ddaf0f0e7ea","resolution":{"observed_at":"2026-08-05T22:21:06.420906Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T22:21:06.402874Z","title":"I2v-adapter: A general image-to-video adapter for diffusion models,","venue":null,"work_id":"65e1d4bd-fdfc-4ddd-b418-bb2e497f0688","year":2024},"citing_paper":{"arxiv_id":"2508.07246","last_updated":"2025-08-10T08:59:32Z","snapshot_observed_at":"2026-08-09T17:42:18.989378Z","submitted_at":"2025-08-10T08:59:32Z","title":"Consistent and Controllable Image Animation with Motion Linear Diffusion Transformers","version":1},"reference_index":93,"source":"pdf_text","source_observed_at":"2026-08-05T22:21:05.600251Z"},"links":{"citing_paper":"/paper/2508.07246"},"observation_digest":"sha256:5ca302853285f972a60769ba2cb4485c6f54ba41c25cf9eac6127075d67e6f8b","observation_id":"2b0f9fe3-e825-4303-bba2-1641b54fb03e","resolution":{"observed_at":"2026-08-05T22:21:06.407301Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T22:21:06.389683Z","title":"LoRA: Low-rank adaptation of large language models,","venue":null,"work_id":"6933d3c9-d6a9-4318-ae09-d74c31c0481b","year":2022},"citing_paper":{"arxiv_id":"2508.07246","last_updated":"2025-08-10T08:59:32Z","snapshot_observed_at":"2026-08-09T17:42:18.989378Z","submitted_at":"2025-08-10T08:59:32Z","title":"Consistent and Controllable Image Animation with Motion Linear Diffusion Transformers","version":1},"reference_index":94,"source":"pdf_text","source_observed_at":"2026-08-05T22:21:05.604048Z"},"links":{"citing_paper":"/paper/2508.07246"},"observation_digest":"sha256:a007551768b6c949710935ca4d1037b45293746b3bafa8458b1ac3056696b734","observation_id":"c0b91193-873c-4738-93c4-5f7a4103ecb9","resolution":{"observed_at":"2026-08-05T22:21:06.394058Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T22:21:05.607990Z","title":"Animate anyone: Consistent and controllable image-to-video synthesis for character animation,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2508.07246","last_updated":"2025-08-10T08:59:32Z","snapshot_observed_at":"2026-08-09T17:42:18.989378Z","submitted_at":"2025-08-10T08:59:32Z","title":"Consistent and Controllable Image Animation with Motion Linear Diffusion Transformers","version":1},"reference_index":95,"source":"pdf_text","source_observed_at":"2026-08-05T22:21:05.607990Z"},"links":{"citing_paper":"/paper/2508.07246"},"observation_digest":"sha256:1dc7077cbbf39de424fb5df23865fbb0f572ab8d882fa056fb259c8d4f7cbbcd","observation_id":"56e9d5ee-a9c1-4bc8-b4d0-f9fad2f6f57e","resolution":{"observed_at":"2026-08-05T22:21:05.607990Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T22:21:06.368184Z","title":"Magicanimate: Temporally consistent human image animation using diffusion model,","venue":null,"work_id":"02cbd59c-5c22-4c9d-96df-47400966eaef","year":2024},"citing_paper":{"arxiv_id":"2508.07246","last_updated":"2025-08-10T08:59:32Z","snapshot_observed_at":"2026-08-09T17:42:18.989378Z","submitted_at":"2025-08-10T08:59:32Z","title":"Consistent and Controllable Image Animation with Motion Linear Diffusion Transformers","version":1},"reference_index":96,"source":"pdf_text","source_observed_at":"2026-08-05T22:21:05.611982Z"},"links":{"citing_paper":"/paper/2508.07246"},"observation_digest":"sha256:4c7c9ac7acabdb0bb7ddf9aa479b285f2f8f93f9cd711fc7c647b85fe0c69271","observation_id":"d02b01f0-496f-4cee-ad38-3b3a59c552ce","resolution":{"observed_at":"2026-08-05T22:21:06.372296Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T22:21:06.355926Z","title":"Snapfusion: Text-to-image diffusion model on mobile devices within two seconds,","venue":null,"work_id":"facd43a6-ded2-4ee0-9d85-c24b2881f4b5","year":2023},"citing_paper":{"arxiv_id":"2508.07246","last_updated":"2025-08-10T08:59:32Z","snapshot_observed_at":"2026-08-09T17:42:18.989378Z","submitted_at":"2025-08-10T08:59:32Z","title":"Consistent and Controllable Image Animation with Motion Linear Diffusion Transformers","version":1},"reference_index":97,"source":"pdf_text","source_observed_at":"2026-08-05T22:21:05.615931Z"},"links":{"citing_paper":"/paper/2508.07246"},"observation_digest":"sha256:82320cc4c6caae642c4e3815cc84fa5f88c54283ebc8318e92494a78813bbe58","observation_id":"66ae15e3-d0b6-41fc-b302-bfb1cce21e73","resolution":{"observed_at":"2026-08-05T22:21:06.359979Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T22:21:06.342815Z","title":"Mobilediffusion: Instant text-to-image generation on mobile devices,","venue":null,"work_id":"1510efdf-018b-4690-accd-3bec3bd61caf","year":2024},"citing_paper":{"arxiv_id":"2508.07246","last_updated":"2025-08-10T08:59:32Z","snapshot_observed_at":"2026-08-09T17:42:18.989378Z","submitted_at":"2025-08-10T08:59:32Z","title":"Consistent and Controllable Image Animation with Motion Linear Diffusion Transformers","version":1},"reference_index":98,"source":"pdf_text","source_observed_at":"2026-08-05T22:21:05.619826Z"},"links":{"citing_paper":"/paper/2508.07246"},"observation_digest":"sha256:14980b79977bcfedb258ea55c2490da739a3ed528c0dcb639661f0542963ae01","observation_id":"6a3c38dd-d68a-4fff-926a-025e1a21e126","resolution":{"observed_at":"2026-08-05T22:21:06.347156Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T22:21:06.330446Z","title":"Bitsfusion: 1.99 bits weight quantization of diffusion model,","venue":null,"work_id":"796c8480-3ca3-4064-a214-32d0d6f1f8b4","year":2024},"citing_paper":{"arxiv_id":"2508.07246","last_updated":"2025-08-10T08:59:32Z","snapshot_observed_at":"2026-08-09T17:42:18.989378Z","submitted_at":"2025-08-10T08:59:32Z","title":"Consistent and Controllable Image Animation with Motion Linear Diffusion Transformers","version":1},"reference_index":99,"source":"pdf_text","source_observed_at":"2026-08-05T22:21:05.623832Z"},"links":{"citing_paper":"/paper/2508.07246"},"observation_digest":"sha256:9832a32d6d71ee626adeb21609b2eea4a5eab91d47e90ceba5f19f8cea076ee4","observation_id":"f787330e-c99e-4383-9e6f-6e90bd909feb","resolution":{"observed_at":"2026-08-05T22:21:06.334514Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2409.02097","last_updated":"2024-10-17T08:09:37Z","snapshot_observed_at":"2026-08-09T17:41:45.360146Z","submitted_at":"2024-09-03T17:54:39Z","title":"LinFusion: 1 GPU, 1 Minute, 16K Image","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2409.02097","snapshot_observed_at":"2026-08-05T22:21:05.627730Z","title":"Linfusion: 1 gpu, 1 minute, 16k image,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2508.07246","last_updated":"2025-08-10T08:59:32Z","snapshot_observed_at":"2026-08-09T17:42:18.989378Z","submitted_at":"2025-08-10T08:59:32Z","title":"Consistent and Controllable Image Animation with Motion Linear Diffusion Transformers","version":1},"reference_index":100,"source":"pdf_text","source_observed_at":"2026-08-05T22:21:05.627730Z"},"links":{"cited_paper":"/paper/2409.02097","citing_paper":"/paper/2508.07246"},"observation_digest":"sha256:cab55c5c1fc920b6bc79d0a0dafe715451f9018bba1810792a0f1bffc28e22bf","observation_id":"19a70a53-fd62-493b-b926-1a63816c9bf1","resolution":{"observed_at":"2026-08-05T22:21:05.627730Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"paper":{"arxiv_id":"2508.07246","last_updated":"2025-08-10T08:59:32Z","latest_version":1,"primary_category":"cs.CV","snapshot_observed_at":"2026-08-09T17:42:18.989378Z","submitted_at":"2025-08-10T08:59:32Z","title":"Consistent and Controllable Image Animation with Motion Linear Diffusion Transformers"},"reference_resolution":{"displayed":100,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":63,"verified_exact":1,"verified_fuzzy":36},"total_outbound_references":126},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"thesis":"As of 10 August 2026, this Paper Citation Record lists 100 of 126 outbound references and 0 inbound Pith citation observations for arXiv:2508.07246."}