{"as_of":"2026-08-21T14:48:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:4c2b56d520ff5918863cc3a0315d41d5e0099799234136b07bf176fe42f15529","coverage":[{"denominator":121,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":100,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-06T19:25:28.645155Z","state":"measured"},{"denominator":100,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":100,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-21T06:32:19.484+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2507.05678/citation-record","integrity":"/paper/2507.05678/integrity","json":"/paper/2507.05678/citation-record.json","paper":"/paper/2507.05678"},"outbound":[{"citation":{"cited_paper":{"arxiv_id":"2411.18673","last_updated":"2025-05-06T13:11:14Z","snapshot_observed_at":"2026-08-16T08:18:45.331169Z","submitted_at":"2024-11-27T18:49:13Z","title":"AC3D: Analyzing and Improving 3D Camera Control in Video Diffusion Transformers","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2411.18673","snapshot_observed_at":"2026-08-06T19:25:27.901583Z","title":"Ac3d: Analyzing and improving 3d camera control in video diffusion trans- formers","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.05678","last_updated":"2025-07-08T05:00:17Z","snapshot_observed_at":"2026-08-06T19:17:57.988428Z","submitted_at":"2025-07-08T05:00:17Z","title":"LiON-LoRA: Rethinking LoRA Fusion to Unify Controllable Spatial and Temporal Generation for Video Diffusion","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-06T19:25:27.901583Z"},"links":{"cited_paper":"/paper/2411.18673","citing_paper":"/paper/2507.05678"},"observation_digest":"sha256:470a4d48a9d0f7669184566f791957e3f12e0ef990d376b827c254611f04ae88","observation_id":"bb4b803a-b2d9-49db-9fca-e734ec4d3cc4","resolution":{"observed_at":"2026-08-06T19:25:27.901583Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:25:27.908945Z","title":"Scaling learning algo- rithms towards AI","venue":null,"work_id":null,"year":2007},"citing_paper":{"arxiv_id":"2507.05678","last_updated":"2025-07-08T05:00:17Z","snapshot_observed_at":"2026-08-06T19:17:57.988428Z","submitted_at":"2025-07-08T05:00:17Z","title":"LiON-LoRA: Rethinking LoRA Fusion to Unify Controllable Spatial and Temporal Generation for Video Diffusion","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-06T19:25:27.908945Z"},"links":{"citing_paper":"/paper/2507.05678"},"observation_digest":"sha256:2a16155a4fcd8c4ec0336e215aa5e593470cab188a5dd1ade7681004ac0fce13","observation_id":"659403e8-6fc7-4efe-a971-169b07e861f2","resolution":{"observed_at":"2026-08-06T19:25:27.908945Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:25:27.915710Z","title":"Improving image generation with better captions","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2507.05678","last_updated":"2025-07-08T05:00:17Z","snapshot_observed_at":"2026-08-06T19:17:57.988428Z","submitted_at":"2025-07-08T05:00:17Z","title":"LiON-LoRA: Rethinking LoRA Fusion to Unify Controllable Spatial and Temporal Generation for Video Diffusion","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-06T19:25:27.915710Z"},"links":{"citing_paper":"/paper/2507.05678"},"observation_digest":"sha256:245d53a97f775a36e01c4ff48419f3e50ecca283f541a441de4da1a3368f6a98","observation_id":"479d2291-927d-4602-8288-455babe42b7c","resolution":{"observed_at":"2026-08-06T19:25:27.915710Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2311.15127","last_updated":"2023-11-25T22:28:38Z","snapshot_observed_at":"2026-08-20T09:39:07.545813Z","submitted_at":"2023-11-25T22:28:38Z","title":"Stable Video Diffusion: Scaling Latent Video Diffusion Models to Large Datasets","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2311.15127","snapshot_observed_at":"2026-08-06T19:25:27.926620Z","title":"Stable video diffusion: Scaling latent video diffusion models to large datasets","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2507.05678","last_updated":"2025-07-08T05:00:17Z","snapshot_observed_at":"2026-08-06T19:17:57.988428Z","submitted_at":"2025-07-08T05:00:17Z","title":"LiON-LoRA: Rethinking LoRA Fusion to Unify Controllable Spatial and Temporal Generation for Video Diffusion","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-06T19:25:27.926620Z"},"links":{"cited_paper":"/paper/2311.15127","citing_paper":"/paper/2507.05678"},"observation_digest":"sha256:a7e34bf5858e89452a3bbc76f06a3667beee1fdc9d8c11688572bb77e4151572","observation_id":"6f5c573a-b932-4538-94ec-16987f5bc3a8","resolution":{"observed_at":"2026-08-06T19:25:27.926620Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:25:27.934400Z","title":"Align your latents: High-resolution video synthe- sis with latent diffusion models","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2507.05678","last_updated":"2025-07-08T05:00:17Z","snapshot_observed_at":"2026-08-06T19:17:57.988428Z","submitted_at":"2025-07-08T05:00:17Z","title":"LiON-LoRA: Rethinking LoRA Fusion to Unify Controllable Spatial and Temporal Generation for Video Diffusion","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-06T19:25:27.934400Z"},"links":{"citing_paper":"/paper/2507.05678"},"observation_digest":"sha256:a8fcb9d53ba0efdb847094b8e2ad0e15371e107882fd8cc7b022193bb9a53626","observation_id":"5c144f3c-bb33-431c-8a15-fe3070cfc85b","resolution":{"observed_at":"2026-08-06T19:25:27.934400Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:25:27.940235Z","title":"Video generation models as world simulators","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2507.05678","last_updated":"2025-07-08T05:00:17Z","snapshot_observed_at":"2026-08-06T19:17:57.988428Z","submitted_at":"2025-07-08T05:00:17Z","title":"LiON-LoRA: Rethinking LoRA Fusion to Unify Controllable Spatial and Temporal Generation for Video Diffusion","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-06T19:25:27.940235Z"},"links":{"citing_paper":"/paper/2507.05678"},"observation_digest":"sha256:dabb3025e7128c46fdf216dab2016c6d988475c9a49e7a1629856879b26c9a7b","observation_id":"ad38f38f-5eaa-421d-86f8-e88cf1b10343","resolution":{"observed_at":"2026-08-06T19:25:27.940235Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:25:27.947458Z","title":"Mvsformer: Multi-view stereo by learning robust image features and temperature-based depth","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2507.05678","last_updated":"2025-07-08T05:00:17Z","snapshot_observed_at":"2026-08-06T19:17:57.988428Z","submitted_at":"2025-07-08T05:00:17Z","title":"LiON-LoRA: Rethinking LoRA Fusion to Unify Controllable Spatial and Temporal Generation for Video Diffusion","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-06T19:25:27.947458Z"},"links":{"citing_paper":"/paper/2507.05678"},"observation_digest":"sha256:59611757cb5f6b1afbe04c2a6c9e7b4e7d13d15c6773044fc4a9b8ce3b00f705","observation_id":"d7087095-442d-430d-88c8-73500ea2d96b","resolution":{"observed_at":"2026-08-06T19:25:27.947458Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2407.08674","last_updated":"2024-07-11T17:06:53Z","snapshot_observed_at":"2026-08-20T10:51:44.257274Z","submitted_at":"2024-07-11T17:06:53Z","title":"Still-Moving: Customized Video Generation without Customized Video Data","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2407.08674","snapshot_observed_at":"2026-08-06T19:25:27.961459Z","title":"Still-moving: Customized video generation without customized video data","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.05678","last_updated":"2025-07-08T05:00:17Z","snapshot_observed_at":"2026-08-06T19:17:57.988428Z","submitted_at":"2025-07-08T05:00:17Z","title":"LiON-LoRA: Rethinking LoRA Fusion to Unify Controllable Spatial and Temporal Generation for Video Diffusion","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-06T19:25:27.961459Z"},"links":{"cited_paper":"/paper/2407.08674","citing_paper":"/paper/2507.05678"},"observation_digest":"sha256:0a67a74b08e6f3eca0f24268049f5c0f333f941e1b5e10f7e81860f7114e2e79","observation_id":"aa11c1e8-73bc-49aa-98ac-3d334a9e9e8a","resolution":{"observed_at":"2026-08-06T19:25:27.961459Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2401.10150","last_updated":"2025-01-08T15:15:12Z","snapshot_observed_at":"2026-08-16T14:26:22.933750Z","submitted_at":"2024-01-18T17:22:37Z","title":"Motion-Zero: Zero-Shot Moving Object Control Framework for Diffusion-Based Video Generation","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2401.10150","snapshot_observed_at":"2026-08-06T19:25:27.973928Z","title":"Motion-zero: Zero-shot mov- ing object control framework for diffusion-based video gen- eration","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.05678","last_updated":"2025-07-08T05:00:17Z","snapshot_observed_at":"2026-08-06T19:17:57.988428Z","submitted_at":"2025-07-08T05:00:17Z","title":"LiON-LoRA: Rethinking LoRA Fusion to Unify Controllable Spatial and Temporal Generation for Video Diffusion","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-06T19:25:27.973928Z"},"links":{"cited_paper":"/paper/2401.10150","citing_paper":"/paper/2507.05678"},"observation_digest":"sha256:d223e8e4c7d4869c9c8c542fb660d3d4e3e0702f03584aa23b22d038bb1a6d96","observation_id":"69d2d4ed-0b5c-41a4-bd3d-c6afdf3d927e","resolution":{"observed_at":"2026-08-06T19:25:27.973928Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2310.19512","last_updated":"2023-10-30T13:12:40Z","snapshot_observed_at":"2026-08-19T21:14:32.076838Z","submitted_at":"2023-10-30T13:12:40Z","title":"VideoCrafter1: Open Diffusion Models for High-Quality Video Generation","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2310.19512","snapshot_observed_at":"2026-08-06T19:25:27.981103Z","title":"Videocrafter1: Open diffusion models for high-quality video generation","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2507.05678","last_updated":"2025-07-08T05:00:17Z","snapshot_observed_at":"2026-08-06T19:17:57.988428Z","submitted_at":"2025-07-08T05:00:17Z","title":"LiON-LoRA: Rethinking LoRA Fusion to Unify Controllable Spatial and Temporal Generation for Video Diffusion","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-06T19:25:27.981103Z"},"links":{"cited_paper":"/paper/2310.19512","citing_paper":"/paper/2507.05678"},"observation_digest":"sha256:950ba1bdecc96fe76ac9b5762c574cb35985bf320943010a404d930b45f793bf","observation_id":"15d65ccb-59b8-430d-991f-7d4d86189b12","resolution":{"observed_at":"2026-08-06T19:25:27.981103Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:25:27.992339Z","title":"Videocrafter2: Overcoming data limitations for high-quality video diffu- sion models","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.05678","last_updated":"2025-07-08T05:00:17Z","snapshot_observed_at":"2026-08-06T19:17:57.988428Z","submitted_at":"2025-07-08T05:00:17Z","title":"LiON-LoRA: Rethinking LoRA Fusion to Unify Controllable Spatial and Temporal Generation for Video Diffusion","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-06T19:25:27.992339Z"},"links":{"citing_paper":"/paper/2507.05678"},"observation_digest":"sha256:310ec5cb4df53f184243fc747cedabf70689c833f6ef4b31b73d10c45d07ea53","observation_id":"f029a99e-a435-46da-bc96-bbdfc27a00b0","resolution":{"observed_at":"2026-08-06T19:25:27.992339Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:25:28.000425Z","title":"Seine: Short-to-long video diffu- sion model for generative transition and prediction","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2507.05678","last_updated":"2025-07-08T05:00:17Z","snapshot_observed_at":"2026-08-06T19:17:57.988428Z","submitted_at":"2025-07-08T05:00:17Z","title":"LiON-LoRA: Rethinking LoRA Fusion to Unify Controllable Spatial and Temporal Generation for Video Diffusion","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-06T19:25:28.000425Z"},"links":{"citing_paper":"/paper/2507.05678"},"observation_digest":"sha256:63ab30fc9e02d3ba8e9428dc4cde8faaa5036464ef5a212c6338b27dccf13dd6","observation_id":"6a642508-7fae-4b6e-bbed-02d2761e118a","resolution":{"observed_at":"2026-08-06T19:25:28.000425Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:25:28.005392Z","title":"Diffusion models beat gans on image synthesis","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2507.05678","last_updated":"2025-07-08T05:00:17Z","snapshot_observed_at":"2026-08-06T19:17:57.988428Z","submitted_at":"2025-07-08T05:00:17Z","title":"LiON-LoRA: Rethinking LoRA Fusion to Unify Controllable Spatial and Temporal Generation for Video Diffusion","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-06T19:25:28.005392Z"},"links":{"citing_paper":"/paper/2507.05678"},"observation_digest":"sha256:774f1502fafdda0355203fffccc5301a205ddb852e7dcd2f23a0010b5255c137","observation_id":"d4143bc7-f2c6-4ae3-ade4-56b32d450860","resolution":{"observed_at":"2026-08-06T19:25:28.005392Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:25:28.012429Z","title":"Parameter-efficient fine-tuning of large-scale pre-trained language models","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2507.05678","last_updated":"2025-07-08T05:00:17Z","snapshot_observed_at":"2026-08-06T19:17:57.988428Z","submitted_at":"2025-07-08T05:00:17Z","title":"LiON-LoRA: Rethinking LoRA Fusion to Unify Controllable Spatial and Temporal Generation for Video Diffusion","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-06T19:25:28.012429Z"},"links":{"citing_paper":"/paper/2507.05678"},"observation_digest":"sha256:d33215c1c3701689c6c8640493fe19ae31821c66df67a36013ba4f745a26e601","observation_id":"416d7ea5-bdf8-4f2d-857b-ddec80aeca2a","resolution":{"observed_at":"2026-08-06T19:25:28.012429Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:25:28.018612Z","title":"Structure and content-guided video synthesis with diffusion models","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2507.05678","last_updated":"2025-07-08T05:00:17Z","snapshot_observed_at":"2026-08-06T19:17:57.988428Z","submitted_at":"2025-07-08T05:00:17Z","title":"LiON-LoRA: Rethinking LoRA Fusion to Unify Controllable Spatial and Temporal Generation for Video Diffusion","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-06T19:25:28.018612Z"},"links":{"citing_paper":"/paper/2507.05678"},"observation_digest":"sha256:4ddadea13ae69b8abb46645e4d4f3ccb5679781fe2f6f8923697c45e7224942e","observation_id":"29ba5a0e-6d2f-45fd-ab6f-e163f789f716","resolution":{"observed_at":"2026-08-06T19:25:28.018612Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:25:28.028943Z","title":"Scaling recti- fied flow transformers for high-resolution image synthesis","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2507.05678","last_updated":"2025-07-08T05:00:17Z","snapshot_observed_at":"2026-08-06T19:17:57.988428Z","submitted_at":"2025-07-08T05:00:17Z","title":"LiON-LoRA: Rethinking LoRA Fusion to Unify Controllable Spatial and Temporal Generation for Video Diffusion","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-06T19:25:28.028943Z"},"links":{"citing_paper":"/paper/2507.05678"},"observation_digest":"sha256:418b4c865162b5dadee93b778dbcc02f98826424abe3939bb6c6e873a0713c60","observation_id":"01e9fa65-7eb8-4d29-84d8-b0fdc2ecf9c7","resolution":{"observed_at":"2026-08-06T19:25:28.028943Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2411.06525","last_updated":"2025-02-28T06:40:38Z","snapshot_observed_at":"2026-08-20T05:00:40.094565Z","submitted_at":"2024-11-10T16:59:39Z","title":"I2VControl-Camera: Precise Video Camera Control with Adjustable Motion Strength","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2411.06525","snapshot_observed_at":"2026-08-06T19:25:28.036792Z","title":"I2vcontrol-camera: Precise video camera control with adjustable motion strength","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.05678","last_updated":"2025-07-08T05:00:17Z","snapshot_observed_at":"2026-08-06T19:17:57.988428Z","submitted_at":"2025-07-08T05:00:17Z","title":"LiON-LoRA: Rethinking LoRA Fusion to Unify Controllable Spatial and Temporal Generation for Video Diffusion","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-06T19:25:28.036792Z"},"links":{"cited_paper":"/paper/2411.06525","citing_paper":"/paper/2507.05678"},"observation_digest":"sha256:eacfad8452e9f135f752063dce75327e1bdfb30cb82116ecceb4fcd5056e6e98","observation_id":"f565dae8-8858-4085-9f20-d5a11b6a27dc","resolution":{"observed_at":"2026-08-06T19:25:28.036792Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:25:28.042603Z","title":"Preserve your own cor- relation: A noise prior for video diffusion models","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2507.05678","last_updated":"2025-07-08T05:00:17Z","snapshot_observed_at":"2026-08-06T19:17:57.988428Z","submitted_at":"2025-07-08T05:00:17Z","title":"LiON-LoRA: Rethinking LoRA Fusion to Unify Controllable Spatial and Temporal Generation for Video Diffusion","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-06T19:25:28.042603Z"},"links":{"citing_paper":"/paper/2507.05678"},"observation_digest":"sha256:89288c0f979694fad6dd2cb31571ae37ed161d26d027e5797b5e6b559db8d71b","observation_id":"aa9e0dd6-9118-4d29-ac13-42d77efe553b","resolution":{"observed_at":"2026-08-06T19:25:28.042603Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2311.10709","last_updated":"2024-08-02T18:55:25Z","snapshot_observed_at":"2026-08-18T16:04:08.688802Z","submitted_at":"2023-11-17T18:59:04Z","title":"Emu Video: Factorizing Text-to-Video Generation by Explicit Image Conditioning","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2311.10709","snapshot_observed_at":"2026-08-06T19:25:28.048695Z","title":"Emu video: Factoriz- ing text-to-video generation by explicit image conditioning","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2507.05678","last_updated":"2025-07-08T05:00:17Z","snapshot_observed_at":"2026-08-06T19:17:57.988428Z","submitted_at":"2025-07-08T05:00:17Z","title":"LiON-LoRA: Rethinking LoRA Fusion to Unify Controllable Spatial and Temporal Generation for Video Diffusion","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-06T19:25:28.048695Z"},"links":{"cited_paper":"/paper/2311.10709","citing_paper":"/paper/2507.05678"},"observation_digest":"sha256:a44258059c1c6d0d72c3ee52484c1a42391e9a5ff2bf367104cd07de039339a1","observation_id":"3f5dd659-901c-45e7-aeb2-0eab12855c8c","resolution":{"observed_at":"2026-08-06T19:25:28.048695Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:25:28.059760Z","title":"Deep learning","venue":null,"work_id":null,"year":2016},"citing_paper":{"arxiv_id":"2507.05678","last_updated":"2025-07-08T05:00:17Z","snapshot_observed_at":"2026-08-06T19:17:57.988428Z","submitted_at":"2025-07-08T05:00:17Z","title":"LiON-LoRA: Rethinking LoRA Fusion to Unify Controllable Spatial and Temporal Generation for Video Diffusion","version":1},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-06T19:25:28.059760Z"},"links":{"citing_paper":"/paper/2507.05678"},"observation_digest":"sha256:bc43ac8e50c911abf5f13b0948e618658c5fd24204aa1760fbd9fee21eeac75d","observation_id":"a8e739df-6c96-4f4e-b602-81ebacf61bfd","resolution":{"observed_at":"2026-08-06T19:25:28.059760Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2311.16933","last_updated":"2023-11-28T16:33:08Z","snapshot_observed_at":"2026-08-20T00:21:09.704724Z","submitted_at":"2023-11-28T16:33:08Z","title":"SparseCtrl: Adding Sparse Controls to Text-to-Video Diffusion Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2311.16933","snapshot_observed_at":"2026-08-06T19:25:28.065592Z","title":"Sparsectrl: Adding sparse con- trols to text-to-video diffusion models","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2507.05678","last_updated":"2025-07-08T05:00:17Z","snapshot_observed_at":"2026-08-06T19:17:57.988428Z","submitted_at":"2025-07-08T05:00:17Z","title":"LiON-LoRA: Rethinking LoRA Fusion to Unify Controllable Spatial and Temporal Generation for Video Diffusion","version":1},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-06T19:25:28.065592Z"},"links":{"cited_paper":"/paper/2311.16933","citing_paper":"/paper/2507.05678"},"observation_digest":"sha256:243da67b5c5cad9db3d2aed3b882a0781175cb12ca2347604a55c06d7c5d978c","observation_id":"bfd6b53b-71f0-4045-a02e-60a64cf5e295","resolution":{"observed_at":"2026-08-06T19:25:28.065592Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2307.04725","last_updated":"2024-02-08T18:08:57Z","snapshot_observed_at":"2026-08-17T14:04:31.230742Z","submitted_at":"2023-07-10T17:34:16Z","title":"AnimateDiff: Animate Your Personalized Text-to-Image Diffusion Models without Specific Tuning","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2307.04725","snapshot_observed_at":"2026-08-06T19:25:28.082739Z","title":"Animatediff: Animate your personalized text- to-image diffusion models without specific tuning","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2507.05678","last_updated":"2025-07-08T05:00:17Z","snapshot_observed_at":"2026-08-06T19:17:57.988428Z","submitted_at":"2025-07-08T05:00:17Z","title":"LiON-LoRA: Rethinking LoRA Fusion to Unify Controllable Spatial and Temporal Generation for Video Diffusion","version":1},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-06T19:25:28.082739Z"},"links":{"cited_paper":"/paper/2307.04725","citing_paper":"/paper/2507.05678"},"observation_digest":"sha256:dc27b6724035aba84ef21d92e68969cbfc69e75ec58ddd285b752bfb036924a4","observation_id":"d781f33d-65ed-4885-afbe-211cd3f35677","resolution":{"observed_at":"2026-08-06T19:25:28.082739Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2404.02101","last_updated":"2025-03-13T18:35:06Z","snapshot_observed_at":"2026-08-16T17:39:09.604516Z","submitted_at":"2024-04-02T16:52:41Z","title":"CameraCtrl: Enabling Camera Control for Text-to-Video Generation","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2404.02101","snapshot_observed_at":"2026-08-06T19:25:28.087675Z","title":"Cameractrl: En- abling camera control for text-to-video generation","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.05678","last_updated":"2025-07-08T05:00:17Z","snapshot_observed_at":"2026-08-06T19:17:57.988428Z","submitted_at":"2025-07-08T05:00:17Z","title":"LiON-LoRA: Rethinking LoRA Fusion to Unify Controllable Spatial and Temporal Generation for Video Diffusion","version":1},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-06T19:25:28.087675Z"},"links":{"cited_paper":"/paper/2404.02101","citing_paper":"/paper/2507.05678"},"observation_digest":"sha256:a5399b47365c4f60b29ca0a8b5f8aecf8d1d52193ebad671124d168a3ebfbf88","observation_id":"5dfc89ce-96c4-4810-bc20-961025596c76","resolution":{"observed_at":"2026-08-06T19:25:28.087675Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:25:28.094595Z","title":"Co-speech gesture video genera- tion via motion-decoupled diffusion model","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.05678","last_updated":"2025-07-08T05:00:17Z","snapshot_observed_at":"2026-08-06T19:17:57.988428Z","submitted_at":"2025-07-08T05:00:17Z","title":"LiON-LoRA: Rethinking LoRA Fusion to Unify Controllable Spatial and Temporal Generation for Video Diffusion","version":1},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-06T19:25:28.094595Z"},"links":{"citing_paper":"/paper/2507.05678"},"observation_digest":"sha256:4e68b36762cf7d0369e308db1b3d4548219301c2ba1b5d7f1ec1a86e31017137","observation_id":"98ef21f2-44b4-44fc-95d4-bced516bb387","resolution":{"observed_at":"2026-08-06T19:25:28.094595Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:25:28.101760Z","title":"Epipolar transformers","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2507.05678","last_updated":"2025-07-08T05:00:17Z","snapshot_observed_at":"2026-08-06T19:17:57.988428Z","submitted_at":"2025-07-08T05:00:17Z","title":"LiON-LoRA: Rethinking LoRA Fusion to Unify Controllable Spatial and Temporal Generation for Video Diffusion","version":1},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-08-06T19:25:28.101760Z"},"links":{"citing_paper":"/paper/2507.05678"},"observation_digest":"sha256:7492332ece190c1e3e025db2de214dbcbaac7a0044c1c8ef74206920367af03c","observation_id":"318f8b21-fa0f-467e-b0fb-51a85d45aaab","resolution":{"observed_at":"2026-08-06T19:25:28.101760Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2211.13221","last_updated":"2023-03-20T17:29:45Z","snapshot_observed_at":"2026-08-17T16:16:01.560363Z","submitted_at":"2022-11-23T18:58:39Z","title":"Latent Video Diffusion Models for High-Fidelity Long Video Generation","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2211.13221","snapshot_observed_at":"2026-08-06T19:25:28.108360Z","title":"Latent video diffusion models for high-fidelity long video generation","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2507.05678","last_updated":"2025-07-08T05:00:17Z","snapshot_observed_at":"2026-08-06T19:17:57.988428Z","submitted_at":"2025-07-08T05:00:17Z","title":"LiON-LoRA: Rethinking LoRA Fusion to Unify Controllable Spatial and Temporal Generation for Video Diffusion","version":1},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-08-06T19:25:28.108360Z"},"links":{"cited_paper":"/paper/2211.13221","citing_paper":"/paper/2507.05678"},"observation_digest":"sha256:fb9d86dba434d4c7c011043b2de29c3da312be5bbb6e7f46c87f091ff8ee1f25","observation_id":"a6326546-dab6-4310-97ec-64de28790f88","resolution":{"observed_at":"2026-08-06T19:25:28.108360Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:25:28.116331Z","title":"Gans trained by a two time-scale update rule converge to a local nash equilib- rium","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2507.05678","last_updated":"2025-07-08T05:00:17Z","snapshot_observed_at":"2026-08-06T19:17:57.988428Z","submitted_at":"2025-07-08T05:00:17Z","title":"LiON-LoRA: Rethinking LoRA Fusion to Unify Controllable Spatial and Temporal Generation for Video Diffusion","version":1},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-08-06T19:25:28.116331Z"},"links":{"citing_paper":"/paper/2507.05678"},"observation_digest":"sha256:182810de0f547936e31281c55064fe238e243ae0fcdf5424d24bb144d7ac7082","observation_id":"a6ba4793-bca3-4dc6-91cf-0b412fc88e4b","resolution":{"observed_at":"2026-08-06T19:25:28.116331Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:25:28.122033Z","title":"Hinton, Simon Osindero, and Yee Whye Teh","venue":null,"work_id":null,"year":2006},"citing_paper":{"arxiv_id":"2507.05678","last_updated":"2025-07-08T05:00:17Z","snapshot_observed_at":"2026-08-06T19:17:57.988428Z","submitted_at":"2025-07-08T05:00:17Z","title":"LiON-LoRA: Rethinking LoRA Fusion to Unify Controllable Spatial and Temporal Generation for Video Diffusion","version":1},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-08-06T19:25:28.122033Z"},"links":{"citing_paper":"/paper/2507.05678"},"observation_digest":"sha256:2fe1e6c4b35817fd0809241633bd8096a0842887dd081184d85a012fe400c785","observation_id":"b21372c1-1638-4277-a7cd-a46cc453fcc4","resolution":{"observed_at":"2026-08-06T19:25:28.122033Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2207.12598","last_updated":"2022-07-26T01:42:07Z","snapshot_observed_at":"2026-08-14T06:37:15.299690Z","submitted_at":"2022-07-26T01:42:07Z","title":"Classifier-Free Diffusion Guidance","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2207.12598","snapshot_observed_at":"2026-08-06T19:25:28.131571Z","title":"Classifier-free diffusion guidance","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2507.05678","last_updated":"2025-07-08T05:00:17Z","snapshot_observed_at":"2026-08-06T19:17:57.988428Z","submitted_at":"2025-07-08T05:00:17Z","title":"LiON-LoRA: Rethinking LoRA Fusion to Unify Controllable Spatial and Temporal Generation for Video Diffusion","version":1},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-08-06T19:25:28.131571Z"},"links":{"cited_paper":"/paper/2207.12598","citing_paper":"/paper/2507.05678"},"observation_digest":"sha256:0305215db375e5c5ce214d807cd976e580f8efb2f57c7bc2a9c76e4e156b049f","observation_id":"20ad04ba-cd74-4cfc-bc89-278f7e9893eb","resolution":{"observed_at":"2026-08-06T19:25:28.131571Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:25:28.138404Z","title":"Denoising dif- fusion probabilistic models","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2507.05678","last_updated":"2025-07-08T05:00:17Z","snapshot_observed_at":"2026-08-06T19:17:57.988428Z","submitted_at":"2025-07-08T05:00:17Z","title":"LiON-LoRA: Rethinking LoRA Fusion to Unify Controllable Spatial and Temporal Generation for Video Diffusion","version":1},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-08-06T19:25:28.138404Z"},"links":{"citing_paper":"/paper/2507.05678"},"observation_digest":"sha256:7b08939c591200528f571c324927cb78e5ca786fd981a76aad60c37effa6d79c","observation_id":"6534bfa1-3523-4bde-851d-67b1243ab395","resolution":{"observed_at":"2026-08-06T19:25:28.138404Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2106.09685","last_updated":"2021-10-16T18:40:34Z","snapshot_observed_at":"2026-08-20T11:47:17.477107Z","submitted_at":"2021-06-17T17:37:18Z","title":"LoRA: Low-Rank Adaptation of Large Language Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2106.09685","snapshot_observed_at":"2026-08-06T19:25:28.152738Z","title":"Lora: Low-rank adaptation of large language models.arXiv preprint arXiv:2106.09685, 2021","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2507.05678","last_updated":"2025-07-08T05:00:17Z","snapshot_observed_at":"2026-08-06T19:17:57.988428Z","submitted_at":"2025-07-08T05:00:17Z","title":"LiON-LoRA: Rethinking LoRA Fusion to Unify Controllable Spatial and Temporal Generation for Video Diffusion","version":1},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-08-06T19:25:28.152738Z"},"links":{"cited_paper":"/paper/2106.09685","citing_paper":"/paper/2507.05678"},"observation_digest":"sha256:f4cc8c42a345b35b4e7d903baa2d455950358ca842e5c8d40d6ca606451db39b","observation_id":"8c875bc6-c240-4083-b023-9678ee54e717","resolution":{"observed_at":"2026-08-06T19:25:28.152738Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:25:28.159982Z","title":"Animate anyone: Consistent and controllable image-to-video synthesis for character animation","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.05678","last_updated":"2025-07-08T05:00:17Z","snapshot_observed_at":"2026-08-06T19:17:57.988428Z","submitted_at":"2025-07-08T05:00:17Z","title":"LiON-LoRA: Rethinking LoRA Fusion to Unify Controllable Spatial and Temporal Generation for Video Diffusion","version":1},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-08-06T19:25:28.159982Z"},"links":{"citing_paper":"/paper/2507.05678"},"observation_digest":"sha256:58f755acb3eec896c853e09c8940c955c119456f5c26127fb5426e79edde8d66","observation_id":"81c59291-4d5e-4f98-b027-1c3b60d97f7c","resolution":{"observed_at":"2026-08-06T19:25:28.159982Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2404.15789","last_updated":"2024-05-01T02:37:18Z","snapshot_observed_at":"2026-08-19T20:24:48.087116Z","submitted_at":"2024-04-24T10:28:54Z","title":"MotionMaster: Training-free Camera Motion Transfer For Video Generation","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2404.15789","snapshot_observed_at":"2026-08-06T19:25:28.165930Z","title":"Mo- tionmaster: Training-free camera motion transfer for video generation","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.05678","last_updated":"2025-07-08T05:00:17Z","snapshot_observed_at":"2026-08-06T19:17:57.988428Z","submitted_at":"2025-07-08T05:00:17Z","title":"LiON-LoRA: Rethinking LoRA Fusion to Unify Controllable Spatial and Temporal Generation for Video Diffusion","version":1},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-08-06T19:25:28.165930Z"},"links":{"cited_paper":"/paper/2404.15789","citing_paper":"/paper/2507.05678"},"observation_digest":"sha256:890a8763a129884d4f4268d8cbff31dc9e3ff25ebe93c9f14343966b365b05c6","observation_id":"09e2d8b0-f7ab-47a5-b43e-8bfa92ee983b","resolution":{"observed_at":"2026-08-06T19:25:28.165930Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2307.13269","last_updated":"2024-08-19T03:31:19Z","snapshot_observed_at":"2026-08-20T05:25:59.382385Z","submitted_at":"2023-07-25T05:39:21Z","title":"LoraHub: Efficient Cross-Task Generalization via Dynamic LoRA Composition","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2307.13269","snapshot_observed_at":"2026-08-06T19:25:28.175661Z","title":"Lorahub: Efficient cross- task generalization via dynamic lora composition","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2507.05678","last_updated":"2025-07-08T05:00:17Z","snapshot_observed_at":"2026-08-06T19:17:57.988428Z","submitted_at":"2025-07-08T05:00:17Z","title":"LiON-LoRA: Rethinking LoRA Fusion to Unify Controllable Spatial and Temporal Generation for Video Diffusion","version":1},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-08-06T19:25:28.175661Z"},"links":{"cited_paper":"/paper/2307.13269","citing_paper":"/paper/2507.05678"},"observation_digest":"sha256:0bde1a1341855f11fe8d243930d6ad9d68abfef8c1f72143140bcffc53ebe5b7","observation_id":"8297e1c4-b74b-4044-b004-dc1303d9888e","resolution":{"observed_at":"2026-08-06T19:25:28.175661Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:25:28.185561Z","title":"Peekaboo: Interactive video generation via masked- diffusion","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.05678","last_updated":"2025-07-08T05:00:17Z","snapshot_observed_at":"2026-08-06T19:17:57.988428Z","submitted_at":"2025-07-08T05:00:17Z","title":"LiON-LoRA: Rethinking LoRA Fusion to Unify Controllable Spatial and Temporal Generation for Video Diffusion","version":1},"reference_index":36,"source":"pdf_text","source_observed_at":"2026-08-06T19:25:28.185561Z"},"links":{"citing_paper":"/paper/2507.05678"},"observation_digest":"sha256:0704fcb444b9c48ca218758de7d1670337c4647d2d4bf76ee803d138638b9d8b","observation_id":"e1a156d0-5fa0-4e40-952c-74a74d15b3be","resolution":{"observed_at":"2026-08-06T19:25:28.185561Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:25:28.191479Z","title":"A survey of multimodal con- trollable diffusion models","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.05678","last_updated":"2025-07-08T05:00:17Z","snapshot_observed_at":"2026-08-06T19:17:57.988428Z","submitted_at":"2025-07-08T05:00:17Z","title":"LiON-LoRA: Rethinking LoRA Fusion to Unify Controllable Spatial and Temporal Generation for Video Diffusion","version":1},"reference_index":37,"source":"pdf_text","source_observed_at":"2026-08-06T19:25:28.191479Z"},"links":{"citing_paper":"/paper/2507.05678"},"observation_digest":"sha256:571205168d36d2cd53f635f08adfea0e896a0bc75d8e3fa506b8f80f4f545e72","observation_id":"26e5c20d-e2b2-440d-a3c9-380b401c2968","resolution":{"observed_at":"2026-08-06T19:25:28.191479Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:25:28.196912Z","title":"Consistent4d: Consistent 360° dynamic object gener- ation from monocular video","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.05678","last_updated":"2025-07-08T05:00:17Z","snapshot_observed_at":"2026-08-06T19:17:57.988428Z","submitted_at":"2025-07-08T05:00:17Z","title":"LiON-LoRA: Rethinking LoRA Fusion to Unify Controllable Spatial and Temporal Generation for Video Diffusion","version":1},"reference_index":38,"source":"pdf_text","source_observed_at":"2026-08-06T19:25:28.196912Z"},"links":{"citing_paper":"/paper/2507.05678"},"observation_digest":"sha256:92e6064af8e0712681b5b5e76b4f08568986b9818d6eb66c346e01a638d9fd0d","observation_id":"f8b8b050-dfe6-45a5-88cc-2373917be3c2","resolution":{"observed_at":"2026-08-06T19:25:28.196912Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:25:28.207923Z","title":"Animate3d: Animating any 3d model with multi-view video diffusion","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2507.05678","last_updated":"2025-07-08T05:00:17Z","snapshot_observed_at":"2026-08-06T19:17:57.988428Z","submitted_at":"2025-07-08T05:00:17Z","title":"LiON-LoRA: Rethinking LoRA Fusion to Unify Controllable Spatial and Temporal Generation for Video Diffusion","version":1},"reference_index":39,"source":"pdf_text","source_observed_at":"2026-08-06T19:25:28.207923Z"},"links":{"citing_paper":"/paper/2507.05678"},"observation_digest":"sha256:866878247f970b79c9e38797b2c22f59496e4781feefcf52d0afd3b46f81930b","observation_id":"30739176-2e02-4511-aa13-815b8346457c","resolution":{"observed_at":"2026-08-06T19:25:28.207923Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:25:28.222210Z","title":"Spad: Spatially aware multi-view diffusers","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.05678","last_updated":"2025-07-08T05:00:17Z","snapshot_observed_at":"2026-08-06T19:17:57.988428Z","submitted_at":"2025-07-08T05:00:17Z","title":"LiON-LoRA: Rethinking LoRA Fusion to Unify Controllable Spatial and Temporal Generation for Video Diffusion","version":1},"reference_index":40,"source":"pdf_text","source_observed_at":"2026-08-06T19:25:28.222210Z"},"links":{"citing_paper":"/paper/2507.05678"},"observation_digest":"sha256:27d3e7ea1e1ea7cbe6022cb68a324e473d850c3fde4bfb9cce6905c10a52ac07","observation_id":"19c5c7c1-2b5e-438d-8112-9e4b20a8ee95","resolution":{"observed_at":"2026-08-06T19:25:28.222210Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:25:28.228235Z","title":"Co- tracker: It is better to track together","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.05678","last_updated":"2025-07-08T05:00:17Z","snapshot_observed_at":"2026-08-06T19:17:57.988428Z","submitted_at":"2025-07-08T05:00:17Z","title":"LiON-LoRA: Rethinking LoRA Fusion to Unify Controllable Spatial and Temporal Generation for Video Diffusion","version":1},"reference_index":41,"source":"pdf_text","source_observed_at":"2026-08-06T19:25:28.228235Z"},"links":{"citing_paper":"/paper/2507.05678"},"observation_digest":"sha256:f05711f7eac8052ec62ef2545d70bb69ea16289648af266f298fe6dd00c1090a","observation_id":"23a662ba-bbc9-4096-89a6-0084289c6fbc","resolution":{"observed_at":"2026-08-06T19:25:28.228235Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:25:28.234440Z","title":"3d gaussian splatting for real-time radiance field rendering","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2507.05678","last_updated":"2025-07-08T05:00:17Z","snapshot_observed_at":"2026-08-06T19:17:57.988428Z","submitted_at":"2025-07-08T05:00:17Z","title":"LiON-LoRA: Rethinking LoRA Fusion to Unify Controllable Spatial and Temporal Generation for Video Diffusion","version":1},"reference_index":42,"source":"pdf_text","source_observed_at":"2026-08-06T19:25:28.234440Z"},"links":{"citing_paper":"/paper/2507.05678"},"observation_digest":"sha256:cd41ba013b1f6e2e321b052162c18872880fa2ab67e638874fcb014bb4c84a99","observation_id":"587556b8-1407-451f-abb6-83aef16250cd","resolution":{"observed_at":"2026-08-06T19:25:28.234440Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2412.03603","last_updated":"2025-03-11T08:14:25Z","snapshot_observed_at":"2026-08-17T07:44:10.213698Z","submitted_at":"2024-12-03T23:52:37Z","title":"HunyuanVideo: A Systematic Framework For Large Video Generative Models","version":6},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2412.03603","snapshot_observed_at":"2026-08-06T19:25:28.241286Z","title":"Hunyuanvideo: A systematic frame- work for large video generative models","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.05678","last_updated":"2025-07-08T05:00:17Z","snapshot_observed_at":"2026-08-06T19:17:57.988428Z","submitted_at":"2025-07-08T05:00:17Z","title":"LiON-LoRA: Rethinking LoRA Fusion to Unify Controllable Spatial and Temporal Generation for Video Diffusion","version":1},"reference_index":43,"source":"pdf_text","source_observed_at":"2026-08-06T19:25:28.241286Z"},"links":{"cited_paper":"/paper/2412.03603","citing_paper":"/paper/2507.05678"},"observation_digest":"sha256:c1e5d14d96ebac25a2b32125c13f936d2542538274167dd64b1c938d5b04cbec","observation_id":"3d36a287-2444-4a78-b6f5-d80719df1b7c","resolution":{"observed_at":"2026-08-06T19:25:28.241286Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:25:28.248424Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.05678","last_updated":"2025-07-08T05:00:17Z","snapshot_observed_at":"2026-08-06T19:17:57.988428Z","submitted_at":"2025-07-08T05:00:17Z","title":"LiON-LoRA: Rethinking LoRA Fusion to Unify Controllable Spatial and Temporal Generation for Video Diffusion","version":1},"reference_index":44,"source":"pdf_text","source_observed_at":"2026-08-06T19:25:28.248424Z"},"links":{"citing_paper":"/paper/2507.05678"},"observation_digest":"sha256:9e9397698293710b81438b47d0e1f51274622098a69343a90a60153f025d714b","observation_id":"986cec0b-11f0-41fb-9bfc-744a263a3d40","resolution":{"observed_at":"2026-08-06T19:25:28.248424Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2502.10059","last_updated":"2025-07-13T08:12:15Z","snapshot_observed_at":"2026-08-17T20:10:03.387661Z","submitted_at":"2025-02-14T10:21:49Z","title":"RealCam-I2V: Real-World Image-to-Video Generation with Interactive Complex Camera Control","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2502.10059","snapshot_observed_at":"2026-08-06T19:25:28.257406Z","title":"Realcam-i2v: Real-world image- to-video generation with interactive complex camera con- trol","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2507.05678","last_updated":"2025-07-08T05:00:17Z","snapshot_observed_at":"2026-08-06T19:17:57.988428Z","submitted_at":"2025-07-08T05:00:17Z","title":"LiON-LoRA: Rethinking LoRA Fusion to Unify Controllable Spatial and Temporal Generation for Video Diffusion","version":1},"reference_index":45,"source":"pdf_text","source_observed_at":"2026-08-06T19:25:28.257406Z"},"links":{"cited_paper":"/paper/2502.10059","citing_paper":"/paper/2507.05678"},"observation_digest":"sha256:79ce7b1bc235268f9ca13ede1ec43c3a12628f801aaccea8d53f47f97f832d73","observation_id":"a2f7f41d-cd25-4ba8-b417-106690dcdd37","resolution":{"observed_at":"2026-08-06T19:25:28.257406Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:25:28.263256Z","title":"Gligen: Open-set grounded text-to-image generation","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2507.05678","last_updated":"2025-07-08T05:00:17Z","snapshot_observed_at":"2026-08-06T19:17:57.988428Z","submitted_at":"2025-07-08T05:00:17Z","title":"LiON-LoRA: Rethinking LoRA Fusion to Unify Controllable Spatial and Temporal Generation for Video Diffusion","version":1},"reference_index":46,"source":"pdf_text","source_observed_at":"2026-08-06T19:25:28.263256Z"},"links":{"citing_paper":"/paper/2507.05678"},"observation_digest":"sha256:9d897141ef6eb3ae1a46b2f7066774e5da46aaa84548575c878cc8b4697022a3","observation_id":"6a00fbd4-699c-4c92-81fc-39f70875d4c7","resolution":{"observed_at":"2026-08-06T19:25:28.263256Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:25:28.272483Z","title":"Generative image dynamics","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.05678","last_updated":"2025-07-08T05:00:17Z","snapshot_observed_at":"2026-08-06T19:17:57.988428Z","submitted_at":"2025-07-08T05:00:17Z","title":"LiON-LoRA: Rethinking LoRA Fusion to Unify Controllable Spatial and Temporal Generation for Video Diffusion","version":1},"reference_index":47,"source":"pdf_text","source_observed_at":"2026-08-06T19:25:28.272483Z"},"links":{"citing_paper":"/paper/2507.05678"},"observation_digest":"sha256:60a8223eea4966da4063aed39b2e6adb553134a02b5bdd1d5c951153c8fa2bff","observation_id":"f8947772-6a2b-4443-995e-90eeb9056db0","resolution":{"observed_at":"2026-08-06T19:25:28.272483Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2412.00131","last_updated":"2024-11-28T14:07:45Z","snapshot_observed_at":"2026-08-13T21:19:07.777045Z","submitted_at":"2024-11-28T14:07:45Z","title":"Open-Sora Plan: Open-Source Large Video Generation Model","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2412.00131","snapshot_observed_at":"2026-08-06T19:25:28.277835Z","title":"Open-sora plan: Open-source large video generation model","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2507.05678","last_updated":"2025-07-08T05:00:17Z","snapshot_observed_at":"2026-08-06T19:17:57.988428Z","submitted_at":"2025-07-08T05:00:17Z","title":"LiON-LoRA: Rethinking LoRA Fusion to Unify Controllable Spatial and Temporal Generation for Video Diffusion","version":1},"reference_index":48,"source":"pdf_text","source_observed_at":"2026-08-06T19:25:28.277835Z"},"links":{"cited_paper":"/paper/2412.00131","citing_paper":"/paper/2507.05678"},"observation_digest":"sha256:25927c8527fed97af284569a01870cf26120a22a91f55870320e2b41031a8d39","observation_id":"a8cd39e5-82eb-46f8-a618-d7bb3e907bec","resolution":{"observed_at":"2026-08-06T19:25:28.277835Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:25:28.284512Z","title":"Magic3d: High- resolution text-to-3d content creation","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2507.05678","last_updated":"2025-07-08T05:00:17Z","snapshot_observed_at":"2026-08-06T19:17:57.988428Z","submitted_at":"2025-07-08T05:00:17Z","title":"LiON-LoRA: Rethinking LoRA Fusion to Unify Controllable Spatial and Temporal Generation for Video Diffusion","version":1},"reference_index":49,"source":"pdf_text","source_observed_at":"2026-08-06T19:25:28.284512Z"},"links":{"citing_paper":"/paper/2507.05678"},"observation_digest":"sha256:7739191e036d788114cd157858cc98fc17bf9bd6da841af5a846a7df888cc32c","observation_id":"b1308da2-1597-4b26-9d35-a9c80a33a74d","resolution":{"observed_at":"2026-08-06T19:25:28.284512Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:25:28.294426Z","title":"Dl3dv-10k: A large-scale scene dataset for deep learning-based 3d vision","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.05678","last_updated":"2025-07-08T05:00:17Z","snapshot_observed_at":"2026-08-06T19:17:57.988428Z","submitted_at":"2025-07-08T05:00:17Z","title":"LiON-LoRA: Rethinking LoRA Fusion to Unify Controllable Spatial and Temporal Generation for Video Diffusion","version":1},"reference_index":50,"source":"pdf_text","source_observed_at":"2026-08-06T19:25:28.294426Z"},"links":{"citing_paper":"/paper/2507.05678"},"observation_digest":"sha256:2d8c47ade320e6decbef79d06f1c38dafbee64ae40220265c17ec968278d355f","observation_id":"661319d0-fa38-4e59-a8b9-de61566f206c","resolution":{"observed_at":"2026-08-06T19:25:28.294426Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:25:28.300814Z","title":"Zero-1-to- 3: Zero-shot one image to 3d object","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2507.05678","last_updated":"2025-07-08T05:00:17Z","snapshot_observed_at":"2026-08-06T19:17:57.988428Z","submitted_at":"2025-07-08T05:00:17Z","title":"LiON-LoRA: Rethinking LoRA Fusion to Unify Controllable Spatial and Temporal Generation for Video Diffusion","version":1},"reference_index":51,"source":"pdf_text","source_observed_at":"2026-08-06T19:25:28.300814Z"},"links":{"citing_paper":"/paper/2507.05678"},"observation_digest":"sha256:7c8fecbe54d81aa48b7ccac1056746ced17727129ca5d70fe071b33b76cf1561","observation_id":"50ac9d32-0635-48ba-ac64-904d7729f9ea","resolution":{"observed_at":"2026-08-06T19:25:28.300814Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2401.03048","last_updated":"2025-05-01T09:40:21Z","snapshot_observed_at":"2026-08-13T10:28:06.516901Z","submitted_at":"2024-01-05T19:55:15Z","title":"Latte: Latent Diffusion Transformer for Video Generation","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2401.03048","snapshot_observed_at":"2026-08-06T19:25:28.308116Z","title":"Latte: Latent diffusion transformer for video generation","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.05678","last_updated":"2025-07-08T05:00:17Z","snapshot_observed_at":"2026-08-06T19:17:57.988428Z","submitted_at":"2025-07-08T05:00:17Z","title":"LiON-LoRA: Rethinking LoRA Fusion to Unify Controllable Spatial and Temporal Generation for Video Diffusion","version":1},"reference_index":52,"source":"pdf_text","source_observed_at":"2026-08-06T19:25:28.308116Z"},"links":{"cited_paper":"/paper/2401.03048","citing_paper":"/paper/2507.05678"},"observation_digest":"sha256:2c7a3741f75ac676c6727307f1812687f3fbc2eaf76bd79626b68e0c37908a74","observation_id":"0340335f-c1ea-4341-a78b-10d573741493","resolution":{"observed_at":"2026-08-06T19:25:28.308116Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:25:28.314474Z","title":"Follow your pose: Pose- guided text-to-video generation using pose-free videos","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.05678","last_updated":"2025-07-08T05:00:17Z","snapshot_observed_at":"2026-08-06T19:17:57.988428Z","submitted_at":"2025-07-08T05:00:17Z","title":"LiON-LoRA: Rethinking LoRA Fusion to Unify Controllable Spatial and Temporal Generation for Video Diffusion","version":1},"reference_index":53,"source":"pdf_text","source_observed_at":"2026-08-06T19:25:28.314474Z"},"links":{"citing_paper":"/paper/2507.05678"},"observation_digest":"sha256:5e39adcfab476ccc12956f5a10f2766e172bc0f23d0907cb8e32b404f52f1c79","observation_id":"59a96822-259c-496a-b4cd-94ea57a38597","resolution":{"observed_at":"2026-08-06T19:25:28.314474Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2108.01073","last_updated":"2022-01-05T00:07:35Z","snapshot_observed_at":"2026-08-20T14:05:04.144690Z","submitted_at":"2021-08-02T17:59:47Z","title":"SDEdit: Guided Image Synthesis and Editing with Stochastic Differential Equations","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2108.01073","snapshot_observed_at":"2026-08-06T19:25:28.321318Z","title":"Sdedit: Guided image synthesis and editing with stochastic differential equations","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2507.05678","last_updated":"2025-07-08T05:00:17Z","snapshot_observed_at":"2026-08-06T19:17:57.988428Z","submitted_at":"2025-07-08T05:00:17Z","title":"LiON-LoRA: Rethinking LoRA Fusion to Unify Controllable Spatial and Temporal Generation for Video Diffusion","version":1},"reference_index":54,"source":"pdf_text","source_observed_at":"2026-08-06T19:25:28.321318Z"},"links":{"cited_paper":"/paper/2108.01073","citing_paper":"/paper/2507.05678"},"observation_digest":"sha256:7f1a821a19929aa2cb0d2ae2cfe2625267b97b83a8e4583e20f9c8123e876e1b","observation_id":"151f142e-2e0b-4914-8555-42544cb7a23a","resolution":{"observed_at":"2026-08-06T19:25:28.321318Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:25:28.326882Z","title":"On distillation of guided diffusion models","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2507.05678","last_updated":"2025-07-08T05:00:17Z","snapshot_observed_at":"2026-08-06T19:17:57.988428Z","submitted_at":"2025-07-08T05:00:17Z","title":"LiON-LoRA: Rethinking LoRA Fusion to Unify Controllable Spatial and Temporal Generation for Video Diffusion","version":1},"reference_index":55,"source":"pdf_text","source_observed_at":"2026-08-06T19:25:28.326882Z"},"links":{"citing_paper":"/paper/2507.05678"},"observation_digest":"sha256:a2658c953bba7698fe853527e60731575096fd1964c0fcf48e9912152a87adaf","observation_id":"06af80e2-42b6-417c-9cdb-fe6ac32aa1f3","resolution":{"observed_at":"2026-08-06T19:25:28.326882Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:25:28.331820Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.05678","last_updated":"2025-07-08T05:00:17Z","snapshot_observed_at":"2026-08-06T19:17:57.988428Z","submitted_at":"2025-07-08T05:00:17Z","title":"LiON-LoRA: Rethinking LoRA Fusion to Unify Controllable Spatial and Temporal Generation for Video Diffusion","version":1},"reference_index":56,"source":"pdf_text","source_observed_at":"2026-08-06T19:25:28.331820Z"},"links":{"citing_paper":"/paper/2507.05678"},"observation_digest":"sha256:86772bf76e12a22b2dce46f673384bbbd83b52ac86e24ccec6a3696632d6116e","observation_id":"2c0e195b-e141-4d5b-ae61-df90144dc82d","resolution":{"observed_at":"2026-08-06T19:25:28.331820Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:25:28.339198Z","title":"T2i-adapter: Learn- ing adapters to dig out more controllable ability for text-to- image diffusion models","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.05678","last_updated":"2025-07-08T05:00:17Z","snapshot_observed_at":"2026-08-06T19:17:57.988428Z","submitted_at":"2025-07-08T05:00:17Z","title":"LiON-LoRA: Rethinking LoRA Fusion to Unify Controllable Spatial and Temporal Generation for Video Diffusion","version":1},"reference_index":57,"source":"pdf_text","source_observed_at":"2026-08-06T19:25:28.339198Z"},"links":{"citing_paper":"/paper/2507.05678"},"observation_digest":"sha256:3615f0eaec8e3369edbc6d1a3fb66c1bf69fcd0a0e2e52d697ca4bb9063a92ae","observation_id":"15830ac2-12bd-4209-9b51-bb2429f7d787","resolution":{"observed_at":"2026-08-06T19:25:28.339198Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2411.04989","last_updated":"2025-02-25T17:27:47Z","snapshot_observed_at":"2026-08-18T03:54:46.911138Z","submitted_at":"2024-11-07T18:56:11Z","title":"SG-I2V: Self-Guided Trajectory Control in Image-to-Video Generation","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2411.04989","snapshot_observed_at":"2026-08-06T19:25:28.344139Z","title":"Sg-i2v: Self- guided trajectory control in image-to-video generation","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.05678","last_updated":"2025-07-08T05:00:17Z","snapshot_observed_at":"2026-08-06T19:17:57.988428Z","submitted_at":"2025-07-08T05:00:17Z","title":"LiON-LoRA: Rethinking LoRA Fusion to Unify Controllable Spatial and Temporal Generation for Video Diffusion","version":1},"reference_index":58,"source":"pdf_text","source_observed_at":"2026-08-06T19:25:28.344139Z"},"links":{"cited_paper":"/paper/2411.04989","citing_paper":"/paper/2507.05678"},"observation_digest":"sha256:a2d083f2df0519bb89d3a1b65211c2368f69e95649a8db54cb26ed4e5746456a","observation_id":"b9073dfa-b28b-4e8a-a54a-89e3025d6cbd","resolution":{"observed_at":"2026-08-06T19:25:28.344139Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2502.18461","last_updated":"2025-03-02T12:44:06Z","snapshot_observed_at":"2026-08-16T12:55:16.007279Z","submitted_at":"2025-02-25T18:59:12Z","title":"K-LoRA: Unlocking Training-Free Fusion of Any Subject and Style LoRAs","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2502.18461","snapshot_observed_at":"2026-08-06T19:25:28.349449Z","title":"K-lora: Unlock- ing training-free fusion of any subject and style loras.arXiv preprint arXiv:2502.18461, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2507.05678","last_updated":"2025-07-08T05:00:17Z","snapshot_observed_at":"2026-08-06T19:17:57.988428Z","submitted_at":"2025-07-08T05:00:17Z","title":"LiON-LoRA: Rethinking LoRA Fusion to Unify Controllable Spatial and Temporal Generation for Video Diffusion","version":1},"reference_index":59,"source":"pdf_text","source_observed_at":"2026-08-06T19:25:28.349449Z"},"links":{"cited_paper":"/paper/2502.18461","citing_paper":"/paper/2507.05678"},"observation_digest":"sha256:8283246e216d8845ea1bbf99fccd8b2c8573069b47a6ea814a4da888e4455ff4","observation_id":"907d01d0-c2c0-4f51-a4da-d2cadf9a67db","resolution":{"observed_at":"2026-08-06T19:25:28.349449Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:25:28.358091Z","title":"Global Structure-from-Motion Revisited","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.05678","last_updated":"2025-07-08T05:00:17Z","snapshot_observed_at":"2026-08-06T19:17:57.988428Z","submitted_at":"2025-07-08T05:00:17Z","title":"LiON-LoRA: Rethinking LoRA Fusion to Unify Controllable Spatial and Temporal Generation for Video Diffusion","version":1},"reference_index":60,"source":"pdf_text","source_observed_at":"2026-08-06T19:25:28.358091Z"},"links":{"citing_paper":"/paper/2507.05678"},"observation_digest":"sha256:1e3e66103607aea7531480ff435028204c97ee81c4790603cdd4839d9e725996","observation_id":"df301191-9c40-4d96-859b-650f9d7e3228","resolution":{"observed_at":"2026-08-06T19:25:28.358091Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:25:28.363569Z","title":"Scalable diffusion mod- els with transformers","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2507.05678","last_updated":"2025-07-08T05:00:17Z","snapshot_observed_at":"2026-08-06T19:17:57.988428Z","submitted_at":"2025-07-08T05:00:17Z","title":"LiON-LoRA: Rethinking LoRA Fusion to Unify Controllable Spatial and Temporal Generation for Video Diffusion","version":1},"reference_index":61,"source":"pdf_text","source_observed_at":"2026-08-06T19:25:28.363569Z"},"links":{"citing_paper":"/paper/2507.05678"},"observation_digest":"sha256:d52d6c72cb924042c3070784d9664905eb232354eadb50091d7d338b6648b0b4","observation_id":"1cb4a8d4-95c1-4469-bbba-ea82907d23cd","resolution":{"observed_at":"2026-08-06T19:25:28.363569Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2408.06070","last_updated":"2025-03-08T08:43:03Z","snapshot_observed_at":"2026-08-19T14:04:38.615117Z","submitted_at":"2024-08-12T11:41:18Z","title":"ControlNeXt: Powerful and Efficient Control for Image and Video Generation","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2408.06070","snapshot_observed_at":"2026-08-06T19:25:28.370404Z","title":"Controlnext: Powerful and effi- cient control for image and video generation.arXiv preprint arXiv:2408.06070, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.05678","last_updated":"2025-07-08T05:00:17Z","snapshot_observed_at":"2026-08-06T19:17:57.988428Z","submitted_at":"2025-07-08T05:00:17Z","title":"LiON-LoRA: Rethinking LoRA Fusion to Unify Controllable Spatial and Temporal Generation for Video Diffusion","version":1},"reference_index":62,"source":"pdf_text","source_observed_at":"2026-08-06T19:25:28.370404Z"},"links":{"cited_paper":"/paper/2408.06070","citing_paper":"/paper/2507.05678"},"observation_digest":"sha256:d710e52be6df01ac84c146f559e550e2bc1fe99544e958bc18ed36e91b5fee81","observation_id":"cef70ea0-f8cb-4780-bbfc-789b0a089316","resolution":{"observed_at":"2026-08-06T19:25:28.370404Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:25:28.375612Z","title":"Analytisch-Geometrische Entwicklungen","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2507.05678","last_updated":"2025-07-08T05:00:17Z","snapshot_observed_at":"2026-08-06T19:17:57.988428Z","submitted_at":"2025-07-08T05:00:17Z","title":"LiON-LoRA: Rethinking LoRA Fusion to Unify Controllable Spatial and Temporal Generation for Video Diffusion","version":1},"reference_index":63,"source":"pdf_text","source_observed_at":"2026-08-06T19:25:28.375612Z"},"links":{"citing_paper":"/paper/2507.05678"},"observation_digest":"sha256:aabbc24c7c3c96b91fcaf2e5e8fa71d436ac6ccdc9f61bb21619daa7b7fed5bd","observation_id":"433439a7-ba41-4f5b-bcf7-ef17639fc7e7","resolution":{"observed_at":"2026-08-06T19:25:28.375612Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2209.14988","last_updated":"2022-09-29T17:50:40Z","snapshot_observed_at":"2026-07-06T13:57:54.539656Z","submitted_at":"2022-09-29T17:50:40Z","title":"DreamFusion: Text-to-3D using 2D Diffusion","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2209.14988","snapshot_observed_at":"2026-08-06T19:25:28.383145Z","title":"Dreamfusion: Text-to-3d using 2d diffusion","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2507.05678","last_updated":"2025-07-08T05:00:17Z","snapshot_observed_at":"2026-08-06T19:17:57.988428Z","submitted_at":"2025-07-08T05:00:17Z","title":"LiON-LoRA: Rethinking LoRA Fusion to Unify Controllable Spatial and Temporal Generation for Video Diffusion","version":1},"reference_index":64,"source":"pdf_text","source_observed_at":"2026-08-06T19:25:28.383145Z"},"links":{"cited_paper":"/paper/2209.14988","citing_paper":"/paper/2507.05678"},"observation_digest":"sha256:72f7bc95a204abc6feb3b8e63e61a71d7e9d70f7511704486918771742ac8713","observation_id":"9d4ccddd-5101-4fec-8c30-7838581f1252","resolution":{"observed_at":"2026-08-06T19:25:28.383145Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2204.06125","last_updated":"2022-04-13T01:10:33Z","snapshot_observed_at":"2026-08-15T12:50:58.405488Z","submitted_at":"2022-04-13T01:10:33Z","title":"Hierarchical Text-Conditional Image Generation with CLIP Latents","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2204.06125","snapshot_observed_at":"2026-08-06T19:25:28.390174Z","title":"Hierarchical text-conditional image generation with clip latents","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2507.05678","last_updated":"2025-07-08T05:00:17Z","snapshot_observed_at":"2026-08-06T19:17:57.988428Z","submitted_at":"2025-07-08T05:00:17Z","title":"LiON-LoRA: Rethinking LoRA Fusion to Unify Controllable Spatial and Temporal Generation for Video Diffusion","version":1},"reference_index":65,"source":"pdf_text","source_observed_at":"2026-08-06T19:25:28.390174Z"},"links":{"cited_paper":"/paper/2204.06125","citing_paper":"/paper/2507.05678"},"observation_digest":"sha256:6b773e264ba38f7de8088439d6ba561b897f72d75bddae630bfaeade33b667c1","observation_id":"5c75b183-2bd9-4926-8f8c-ce3ec0a2008d","resolution":{"observed_at":"2026-08-06T19:25:28.390174Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2402.04324","last_updated":"2024-07-01T03:57:55Z","snapshot_observed_at":"2026-08-19T13:04:56.811027Z","submitted_at":"2024-02-06T19:08:18Z","title":"ConsistI2V: Enhancing Visual Consistency for Image-to-Video Generation","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.04324","snapshot_observed_at":"2026-08-06T19:25:28.396056Z","title":"Consisti2v: En- hancing visual consistency for image-to-video generation","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.05678","last_updated":"2025-07-08T05:00:17Z","snapshot_observed_at":"2026-08-06T19:17:57.988428Z","submitted_at":"2025-07-08T05:00:17Z","title":"LiON-LoRA: Rethinking LoRA Fusion to Unify Controllable Spatial and Temporal Generation for Video Diffusion","version":1},"reference_index":66,"source":"pdf_text","source_observed_at":"2026-08-06T19:25:28.396056Z"},"links":{"cited_paper":"/paper/2402.04324","citing_paper":"/paper/2507.05678"},"observation_digest":"sha256:9c7df4fb33e20d4c4a8a4816f5bd52faf44a255227f65677b49973bdacbe5182","observation_id":"bcba4b91-6999-41c5-9b81-fac20d222ce1","resolution":{"observed_at":"2026-08-06T19:25:28.396056Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:25:28.403350Z","title":"High-resolution image synthesis with latent diffusion models","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2507.05678","last_updated":"2025-07-08T05:00:17Z","snapshot_observed_at":"2026-08-06T19:17:57.988428Z","submitted_at":"2025-07-08T05:00:17Z","title":"LiON-LoRA: Rethinking LoRA Fusion to Unify Controllable Spatial and Temporal Generation for Video Diffusion","version":1},"reference_index":67,"source":"pdf_text","source_observed_at":"2026-08-06T19:25:28.403350Z"},"links":{"citing_paper":"/paper/2507.05678"},"observation_digest":"sha256:336ff8b636652efd425a97357be93bb7ce49f22493e1a0f8123c8dfe3db21eea","observation_id":"6771a957-5fa1-4c6f-8ba2-8ae87212cb52","resolution":{"observed_at":"2026-08-06T19:25:28.403350Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:25:28.413485Z","title":"Mm-diffusion: Learning multi-modal diffusion mod- els for joint audio and video generation","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2507.05678","last_updated":"2025-07-08T05:00:17Z","snapshot_observed_at":"2026-08-06T19:17:57.988428Z","submitted_at":"2025-07-08T05:00:17Z","title":"LiON-LoRA: Rethinking LoRA Fusion to Unify Controllable Spatial and Temporal Generation for Video Diffusion","version":1},"reference_index":68,"source":"pdf_text","source_observed_at":"2026-08-06T19:25:28.413485Z"},"links":{"citing_paper":"/paper/2507.05678"},"observation_digest":"sha256:e8b9c6dba62ba700b5c3520b2cce76635f97c6edf450b69b4f04fd94a51a488e","observation_id":"90f1b51e-584c-4041-9ace-de1ef9ece206","resolution":{"observed_at":"2026-08-06T19:25:28.413485Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:25:33.337802Z","title":"Gen-3 alpha","venue":null,"work_id":"3977f596-a393-4811-b954-d7fd7713ea67","year":2024},"citing_paper":{"arxiv_id":"2507.05678","last_updated":"2025-07-08T05:00:17Z","snapshot_observed_at":"2026-08-06T19:17:57.988428Z","submitted_at":"2025-07-08T05:00:17Z","title":"LiON-LoRA: Rethinking LoRA Fusion to Unify Controllable Spatial and Temporal Generation for Video Diffusion","version":1},"reference_index":69,"source":"pdf_text","source_observed_at":"2026-08-06T19:25:28.419871Z"},"links":{"citing_paper":"/paper/2507.05678"},"observation_digest":"sha256:a7865423d47fdeaaca11685822528287f9aaa3196ac17980fae85fdeb85edf1f","observation_id":"f20a4cbd-e81c-4c73-bb1d-f1783e107555","resolution":{"observed_at":"2026-08-06T19:25:33.395074Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:25:33.218503Z","title":"Photorealistic text-to-image diffusion models with deep language understanding","venue":null,"work_id":"58dac751-944e-423a-a3c3-35ef72623623","year":2022},"citing_paper":{"arxiv_id":"2507.05678","last_updated":"2025-07-08T05:00:17Z","snapshot_observed_at":"2026-08-06T19:17:57.988428Z","submitted_at":"2025-07-08T05:00:17Z","title":"LiON-LoRA: Rethinking LoRA Fusion to Unify Controllable Spatial and Temporal Generation for Video Diffusion","version":1},"reference_index":70,"source":"pdf_text","source_observed_at":"2026-08-06T19:25:28.428617Z"},"links":{"citing_paper":"/paper/2507.05678"},"observation_digest":"sha256:93eb3b630e8617f5d9925a683a77f133e967b8d5fa2d68e1078a616b88352690","observation_id":"0584869b-a021-4ed2-8fd8-7ed76229aefe","resolution":{"observed_at":"2026-08-06T19:25:33.271231Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:25:28.435992Z","title":"Structure-from-motion revisited","venue":null,"work_id":null,"year":2016},"citing_paper":{"arxiv_id":"2507.05678","last_updated":"2025-07-08T05:00:17Z","snapshot_observed_at":"2026-08-06T19:17:57.988428Z","submitted_at":"2025-07-08T05:00:17Z","title":"LiON-LoRA: Rethinking LoRA Fusion to Unify Controllable Spatial and Temporal Generation for Video Diffusion","version":1},"reference_index":71,"source":"pdf_text","source_observed_at":"2026-08-06T19:25:28.435992Z"},"links":{"citing_paper":"/paper/2507.05678"},"observation_digest":"sha256:cce7d84170e5349f153426a3b771630f82b436f8aab34413198ee8029b0c4a0a","observation_id":"ff4d4496-0c39-48ee-b56c-b0112a4c3263","resolution":{"observed_at":"2026-08-06T19:25:28.435992Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:25:33.111671Z","title":"Structure-from-Motion Revisited","venue":null,"work_id":"4cda7a91-02e2-4b2f-82d9-651223afc1af","year":2016},"citing_paper":{"arxiv_id":"2507.05678","last_updated":"2025-07-08T05:00:17Z","snapshot_observed_at":"2026-08-06T19:17:57.988428Z","submitted_at":"2025-07-08T05:00:17Z","title":"LiON-LoRA: Rethinking LoRA Fusion to Unify Controllable Spatial and Temporal Generation for Video Diffusion","version":1},"reference_index":72,"source":"pdf_text","source_observed_at":"2026-08-06T19:25:28.442871Z"},"links":{"citing_paper":"/paper/2507.05678"},"observation_digest":"sha256:428b6d1d0684ec84f9abee3b55bf7c7e51ca44455a0f8c83985dbfe5dba75a75","observation_id":"c50a4da4-5ee1-4151-8566-17e282ca0c7f","resolution":{"observed_at":"2026-08-06T19:25:33.164491Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:25:32.936228Z","title":"Pixelwise view selection for unstructured multi-view stereo","venue":null,"work_id":"73169ef5-08e3-497c-8589-c6c32d7c347c","year":2016},"citing_paper":{"arxiv_id":"2507.05678","last_updated":"2025-07-08T05:00:17Z","snapshot_observed_at":"2026-08-06T19:17:57.988428Z","submitted_at":"2025-07-08T05:00:17Z","title":"LiON-LoRA: Rethinking LoRA Fusion to Unify Controllable Spatial and Temporal Generation for Video Diffusion","version":1},"reference_index":73,"source":"pdf_text","source_observed_at":"2026-08-06T19:25:28.448276Z"},"links":{"citing_paper":"/paper/2507.05678"},"observation_digest":"sha256:220cdee95f533f251ceb46630ee4206c3993884668ce49415edf04350dc61ece","observation_id":"dd554bce-630c-42ba-80bf-edec40010b3b","resolution":{"observed_at":"2026-08-06T19:25:33.017680Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:25:32.778278Z","title":"Ziplora: Any subject in any style by effectively merging loras","venue":null,"work_id":"1bc1735e-659a-4570-bdf4-fd54ecb833e3","year":2023},"citing_paper":{"arxiv_id":"2507.05678","last_updated":"2025-07-08T05:00:17Z","snapshot_observed_at":"2026-08-06T19:17:57.988428Z","submitted_at":"2025-07-08T05:00:17Z","title":"LiON-LoRA: Rethinking LoRA Fusion to Unify Controllable Spatial and Temporal Generation for Video Diffusion","version":1},"reference_index":74,"source":"pdf_text","source_observed_at":"2026-08-06T19:25:28.455212Z"},"links":{"citing_paper":"/paper/2507.05678"},"observation_digest":"sha256:8a5a3965881ca24b4858e5fa23b7a78a02da63815cf91eb8d01d139ef37f8f4d","observation_id":"9a8a278d-c0b6-4efa-8703-1616d2a8ca7e","resolution":{"observed_at":"2026-08-06T19:25:32.827955Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2404.05674","last_updated":"2024-04-08T16:55:49Z","snapshot_observed_at":"2026-08-19T05:50:01.288032Z","submitted_at":"2024-04-08T16:55:49Z","title":"MoMA: Multimodal LLM Adapter for Fast Personalized Image Generation","version":1},"cited_work":{"arxiv_id":"2404.05674","doi":null,"metadata_source":"pith","pith_arxiv_id":"2404.05674","snapshot_observed_at":"2026-08-06T19:25:29.669593Z","title":"MoMA: Multimodal LLM Adapter for Fast Personalized Image Generation","venue":"cs.CV","work_id":"0103a678-8407-4842-aed9-19b8d56af99c","year":2024},"citing_paper":{"arxiv_id":"2507.05678","last_updated":"2025-07-08T05:00:17Z","snapshot_observed_at":"2026-08-06T19:17:57.988428Z","submitted_at":"2025-07-08T05:00:17Z","title":"LiON-LoRA: Rethinking LoRA Fusion to Unify Controllable Spatial and Temporal Generation for Video Diffusion","version":1},"reference_index":75,"source":"pdf_text","source_observed_at":"2026-08-06T19:25:28.468845Z"},"links":{"cited_paper":"/paper/2404.05674","citing_paper":"/paper/2507.05678"},"observation_digest":"sha256:84f13306a603697fc32ddb00aeefb910427dd29424e12b289ad9e1b2cbeec2bc","observation_id":"f5252754-2555-4908-a5df-f20c5573683e","resolution":{"observed_at":"2026-08-06T19:25:29.680556Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2011.13456","last_updated":"2021-02-10T18:17:04Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2020-11-26T19:39:10Z","title":"Score-Based Generative Modeling through Stochastic Differential Equations","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2011.13456","snapshot_observed_at":"2026-08-06T19:25:28.478735Z","title":"Score- based generative modeling through stochastic differential equations","venue":null,"work_id":null,"year":2011},"citing_paper":{"arxiv_id":"2507.05678","last_updated":"2025-07-08T05:00:17Z","snapshot_observed_at":"2026-08-06T19:17:57.988428Z","submitted_at":"2025-07-08T05:00:17Z","title":"LiON-LoRA: Rethinking LoRA Fusion to Unify Controllable Spatial and Temporal Generation for Video Diffusion","version":1},"reference_index":76,"source":"pdf_text","source_observed_at":"2026-08-06T19:25:28.478735Z"},"links":{"cited_paper":"/paper/2011.13456","citing_paper":"/paper/2507.05678"},"observation_digest":"sha256:b1945218792c2b38a791daf2aa7ba676fb3d7fc43f5a2487803347e024e87289","observation_id":"e3f62e5c-eac9-46c5-b392-b3af7754167a","resolution":{"observed_at":"2026-08-06T19:25:28.478735Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2411.04928","last_updated":"2024-11-07T18:07:31Z","snapshot_observed_at":"2026-08-16T13:02:01.454341Z","submitted_at":"2024-11-07T18:07:31Z","title":"DimensionX: Create Any 3D and 4D Scenes from a Single Image with Controllable Video Diffusion","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2411.04928","snapshot_observed_at":"2026-08-06T19:25:28.485901Z","title":"Dimensionx: Create any 3d and 4d scenes from a single image with con- trollable video diffusion","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2507.05678","last_updated":"2025-07-08T05:00:17Z","snapshot_observed_at":"2026-08-06T19:17:57.988428Z","submitted_at":"2025-07-08T05:00:17Z","title":"LiON-LoRA: Rethinking LoRA Fusion to Unify Controllable Spatial and Temporal Generation for Video Diffusion","version":1},"reference_index":77,"source":"pdf_text","source_observed_at":"2026-08-06T19:25:28.485901Z"},"links":{"cited_paper":"/paper/2411.04928","citing_paper":"/paper/2507.05678"},"observation_digest":"sha256:8737d5c2a3336d2f36941e1b930714c06c45efe1b7733593a605138447ccc6be","observation_id":"aa499822-13ce-48d2-bfee-33fa71b14ed0","resolution":{"observed_at":"2026-08-06T19:25:28.485901Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2312.09305","last_updated":"2024-02-07T08:15:51Z","snapshot_observed_at":"2026-08-16T14:34:37.647139Z","submitted_at":"2023-12-14T19:18:38Z","title":"Stable Score Distillation for High-Quality 3D Generation","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2312.09305","snapshot_observed_at":"2026-08-06T19:25:28.493365Z","title":"Stable score distillation for high-quality 3d generation","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2507.05678","last_updated":"2025-07-08T05:00:17Z","snapshot_observed_at":"2026-08-06T19:17:57.988428Z","submitted_at":"2025-07-08T05:00:17Z","title":"LiON-LoRA: Rethinking LoRA Fusion to Unify Controllable Spatial and Temporal Generation for Video Diffusion","version":1},"reference_index":78,"source":"pdf_text","source_observed_at":"2026-08-06T19:25:28.493365Z"},"links":{"cited_paper":"/paper/2312.09305","citing_paper":"/paper/2507.05678"},"observation_digest":"sha256:65a107a5847d14d7f9d745888ebe3a199e5cc5048de47331cff263738c30767c","observation_id":"32230957-325d-4f58-bd71-1d1f865fe31c","resolution":{"observed_at":"2026-08-06T19:25:28.493365Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2309.16653","last_updated":"2024-03-29T08:39:23Z","snapshot_observed_at":"2026-07-06T16:25:05.493379Z","submitted_at":"2023-09-28T17:55:05Z","title":"DreamGaussian: Generative Gaussian Splatting for Efficient 3D Content Creation","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2309.16653","snapshot_observed_at":"2026-08-06T19:25:28.499516Z","title":"Dreamgaussian: Generative gaussian splat- ting for efficient 3d content creation","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2507.05678","last_updated":"2025-07-08T05:00:17Z","snapshot_observed_at":"2026-08-06T19:17:57.988428Z","submitted_at":"2025-07-08T05:00:17Z","title":"LiON-LoRA: Rethinking LoRA Fusion to Unify Controllable Spatial and Temporal Generation for Video Diffusion","version":1},"reference_index":79,"source":"pdf_text","source_observed_at":"2026-08-06T19:25:28.499516Z"},"links":{"cited_paper":"/paper/2309.16653","citing_paper":"/paper/2507.05678"},"observation_digest":"sha256:0ef51ee943cda61b4cddfd3711ae0ad0a9423f3980b81855963cd0552dea04d3","observation_id":"4b768435-bf98-4eba-b45f-8ed33a645e6b","resolution":{"observed_at":"2026-08-06T19:25:28.499516Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:25:32.602021Z","title":"Any-to-any generation via composable diffusion","venue":null,"work_id":"fd9db68b-e068-47ab-b007-3161dc2127f5","year":2023},"citing_paper":{"arxiv_id":"2507.05678","last_updated":"2025-07-08T05:00:17Z","snapshot_observed_at":"2026-08-06T19:17:57.988428Z","submitted_at":"2025-07-08T05:00:17Z","title":"LiON-LoRA: Rethinking LoRA Fusion to Unify Controllable Spatial and Temporal Generation for Video Diffusion","version":1},"reference_index":80,"source":"pdf_text","source_observed_at":"2026-08-06T19:25:28.505384Z"},"links":{"citing_paper":"/paper/2507.05678"},"observation_digest":"sha256:3a4c4d1338f6adb4d23f7fdd0e5a26a5d473886d113ab524c4e88676f87b7389","observation_id":"029284de-5e81-4093-8751-f5984dfb5aca","resolution":{"observed_at":"2026-08-06T19:25:32.652113Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2402.17485","last_updated":"2024-08-08T03:48:38Z","snapshot_observed_at":"2026-08-20T08:43:15.720979Z","submitted_at":"2024-02-27T13:10:11Z","title":"EMO: Emote Portrait Alive -- Generating Expressive Portrait Videos with Audio2Video Diffusion Model under Weak Conditions","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.17485","snapshot_observed_at":"2026-08-06T19:25:28.512015Z","title":"Emo: Emote portrait alive-generating expressive portrait videos with audio2video diffusion model under weak conditions","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.05678","last_updated":"2025-07-08T05:00:17Z","snapshot_observed_at":"2026-08-06T19:17:57.988428Z","submitted_at":"2025-07-08T05:00:17Z","title":"LiON-LoRA: Rethinking LoRA Fusion to Unify Controllable Spatial and Temporal Generation for Video Diffusion","version":1},"reference_index":81,"source":"pdf_text","source_observed_at":"2026-08-06T19:25:28.512015Z"},"links":{"cited_paper":"/paper/2402.17485","citing_paper":"/paper/2507.05678"},"observation_digest":"sha256:16cd1a571326cb4ee2205f36ab34b7cdecf1565bc8f1a92ff38a5d9b4b1aa7a8","observation_id":"373443ca-b19e-4fc8-b795-9da3e87a7a33","resolution":{"observed_at":"2026-08-06T19:25:28.512015Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:25:32.433396Z","title":"Vision transformers need registers","venue":null,"work_id":"a5d42f1a-595d-4309-8d64-073ecc6f69a3","year":2024},"citing_paper":{"arxiv_id":"2507.05678","last_updated":"2025-07-08T05:00:17Z","snapshot_observed_at":"2026-08-06T19:17:57.988428Z","submitted_at":"2025-07-08T05:00:17Z","title":"LiON-LoRA: Rethinking LoRA Fusion to Unify Controllable Spatial and Temporal Generation for Video Diffusion","version":1},"reference_index":82,"source":"pdf_text","source_observed_at":"2026-08-06T19:25:28.518091Z"},"links":{"citing_paper":"/paper/2507.05678"},"observation_digest":"sha256:293def5d7354f337b2674cf64f492be3d5f7712050baed327419ac964488302a","observation_id":"9d407440-9fe4-4a45-8d7c-547fa84eccf5","resolution":{"observed_at":"2026-08-06T19:25:32.480367Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:25:32.293562Z","title":"Consistent view syn- thesis with pose-guided diffusion models","venue":null,"work_id":"282999ea-39f9-43b7-a6b6-fb2765d34494","year":2023},"citing_paper":{"arxiv_id":"2507.05678","last_updated":"2025-07-08T05:00:17Z","snapshot_observed_at":"2026-08-06T19:17:57.988428Z","submitted_at":"2025-07-08T05:00:17Z","title":"LiON-LoRA: Rethinking LoRA Fusion to Unify Controllable Spatial and Temporal Generation for Video Diffusion","version":1},"reference_index":83,"source":"pdf_text","source_observed_at":"2026-08-06T19:25:28.523545Z"},"links":{"citing_paper":"/paper/2507.05678"},"observation_digest":"sha256:726d2dbfee2213ac5870f1e0e7c01fac3dcdbe4fcb010fe44f602ef5f601c286","observation_id":"34ab8c20-16ed-4a51-b94b-38d4e4eaccc8","resolution":{"observed_at":"2026-08-06T19:25:32.335109Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1812.01717","last_updated":"2019-03-27T16:43:17Z","snapshot_observed_at":"2026-08-18T04:00:09.136122Z","submitted_at":"2018-12-03T03:57:42Z","title":"Towards Accurate Generative Models of Video: A New Metric & Challenges","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1812.01717","snapshot_observed_at":"2026-08-06T19:25:28.529325Z","title":"Towards accurate generative models of video: A new met- ric & challenges","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2507.05678","last_updated":"2025-07-08T05:00:17Z","snapshot_observed_at":"2026-08-06T19:17:57.988428Z","submitted_at":"2025-07-08T05:00:17Z","title":"LiON-LoRA: Rethinking LoRA Fusion to Unify Controllable Spatial and Temporal Generation for Video Diffusion","version":1},"reference_index":84,"source":"pdf_text","source_observed_at":"2026-08-06T19:25:28.529325Z"},"links":{"cited_paper":"/paper/1812.01717","citing_paper":"/paper/2507.05678"},"observation_digest":"sha256:5cb8868599409088529ff0ea32b6ad56776f7fcab91e7ee17b2973a6c4079fd9","observation_id":"4d44d9ac-058a-4f2d-bb41-b6650767826e","resolution":{"observed_at":"2026-08-06T19:25:28.529325Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2308.06571","last_updated":"2023-08-12T13:53:10Z","snapshot_observed_at":"2026-08-14T13:59:50.878772Z","submitted_at":"2023-08-12T13:53:10Z","title":"ModelScope Text-to-Video Technical Report","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2308.06571","snapshot_observed_at":"2026-08-06T19:25:28.535130Z","title":"Modelscope text-to-video technical report","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2507.05678","last_updated":"2025-07-08T05:00:17Z","snapshot_observed_at":"2026-08-06T19:17:57.988428Z","submitted_at":"2025-07-08T05:00:17Z","title":"LiON-LoRA: Rethinking LoRA Fusion to Unify Controllable Spatial and Temporal Generation for Video Diffusion","version":1},"reference_index":85,"source":"pdf_text","source_observed_at":"2026-08-06T19:25:28.535130Z"},"links":{"cited_paper":"/paper/2308.06571","citing_paper":"/paper/2507.05678"},"observation_digest":"sha256:03533ce531e9bebe0e437349ce8b4b1771adf242cd7fd451a5b9da1d8592cf5d","observation_id":"d82f31f4-f576-4434-95ce-d253f1e5f7a9","resolution":{"observed_at":"2026-08-06T19:25:28.535130Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:25:32.154507Z","title":"Disco: Disentangled control for referring hu- man dance generation in real world","venue":null,"work_id":"792fa61d-1242-4540-bb7c-195666e7a031","year":2023},"citing_paper":{"arxiv_id":"2507.05678","last_updated":"2025-07-08T05:00:17Z","snapshot_observed_at":"2026-08-06T19:17:57.988428Z","submitted_at":"2025-07-08T05:00:17Z","title":"LiON-LoRA: Rethinking LoRA Fusion to Unify Controllable Spatial and Temporal Generation for Video Diffusion","version":1},"reference_index":86,"source":"pdf_text","source_observed_at":"2026-08-06T19:25:28.545304Z"},"links":{"citing_paper":"/paper/2507.05678"},"observation_digest":"sha256:a4a00bd5b12763ce37a6f85e696e28e4e80c53fbb822149ba669e91ff5dc481f","observation_id":"80d897ab-fc34-4d12-bf01-d340b94f8e5d","resolution":{"observed_at":"2026-08-06T19:25:32.202336Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:25:32.000470Z","title":"Videofactory: Swap attention in spatiotemporal diffusions for text-to-video gen- eration, 2024","venue":null,"work_id":"bfa46d16-47ad-4b0d-9819-b2b71e99c27e","year":2024},"citing_paper":{"arxiv_id":"2507.05678","last_updated":"2025-07-08T05:00:17Z","snapshot_observed_at":"2026-08-06T19:17:57.988428Z","submitted_at":"2025-07-08T05:00:17Z","title":"LiON-LoRA: Rethinking LoRA Fusion to Unify Controllable Spatial and Temporal Generation for Video Diffusion","version":1},"reference_index":87,"source":"pdf_text","source_observed_at":"2026-08-06T19:25:28.551122Z"},"links":{"citing_paper":"/paper/2507.05678"},"observation_digest":"sha256:1ea2c73c08597ca02e9eb6ba097fa3f1de0b42f76ba5bf0d5fb531d6a8c6948e","observation_id":"e5d724a3-506f-45e4-9e3c-9d6b23262dc7","resolution":{"observed_at":"2026-08-06T19:25:32.069319Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:25:31.860381Z","title":"Videocomposer: Compositional video syn- thesis with motion controllability","venue":null,"work_id":"441b6376-041a-490a-a773-bfd2f76e3d2f","year":2024},"citing_paper":{"arxiv_id":"2507.05678","last_updated":"2025-07-08T05:00:17Z","snapshot_observed_at":"2026-08-06T19:17:57.988428Z","submitted_at":"2025-07-08T05:00:17Z","title":"LiON-LoRA: Rethinking LoRA Fusion to Unify Controllable Spatial and Temporal Generation for Video Diffusion","version":1},"reference_index":88,"source":"pdf_text","source_observed_at":"2026-08-06T19:25:28.557578Z"},"links":{"citing_paper":"/paper/2507.05678"},"observation_digest":"sha256:968528e829feea9a9456307ea7b3b360501b68d9ec77f37673e7fc2b93ee99df","observation_id":"22e113c8-6cf1-40b7-a4ab-2e28b1a36f3f","resolution":{"observed_at":"2026-08-06T19:25:31.908165Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2309.15103","last_updated":"2023-09-27T03:51:52Z","snapshot_observed_at":"2026-08-17T12:21:00.357059Z","submitted_at":"2023-09-26T17:52:03Z","title":"LAVIE: High-Quality Video Generation with Cascaded Latent Diffusion Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2309.15103","snapshot_observed_at":"2026-08-06T19:25:28.562803Z","title":"Lavie: High-quality video genera- tion with cascaded latent diffusion models","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2507.05678","last_updated":"2025-07-08T05:00:17Z","snapshot_observed_at":"2026-08-06T19:17:57.988428Z","submitted_at":"2025-07-08T05:00:17Z","title":"LiON-LoRA: Rethinking LoRA Fusion to Unify Controllable Spatial and Temporal Generation for Video Diffusion","version":1},"reference_index":89,"source":"pdf_text","source_observed_at":"2026-08-06T19:25:28.562803Z"},"links":{"cited_paper":"/paper/2309.15103","citing_paper":"/paper/2507.05678"},"observation_digest":"sha256:fd325c0ad637b7bdd59285fdf41f303d803ea46a315ebd6a8ad43bdd0a9ec930","observation_id":"baecef64-c3f0-4999-909b-2d9a94a61892","resolution":{"observed_at":"2026-08-06T19:25:28.562803Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:25:28.570065Z","title":"Customvideo: Customizing text- to-video generation with multiple subjects","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.05678","last_updated":"2025-07-08T05:00:17Z","snapshot_observed_at":"2026-08-06T19:17:57.988428Z","submitted_at":"2025-07-08T05:00:17Z","title":"LiON-LoRA: Rethinking LoRA Fusion to Unify Controllable Spatial and Temporal Generation for Video Diffusion","version":1},"reference_index":90,"source":"pdf_text","source_observed_at":"2026-08-06T19:25:28.570065Z"},"links":{"citing_paper":"/paper/2507.05678"},"observation_digest":"sha256:8d9ea347ea01395b300d675ac8af6ae97a6f1fef3a6f7e5aaa73b23cfe981dcb","observation_id":"e55b5b6f-ebb4-4049-8a25-7da9c4b34cea","resolution":{"observed_at":"2026-08-06T19:25:28.570065Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:25:31.721917Z","title":"Motionctrl: A unified and flexible motion controller for video generation","venue":null,"work_id":"377cf64e-aa7d-4c00-87f2-d246bed812a7","year":2024},"citing_paper":{"arxiv_id":"2507.05678","last_updated":"2025-07-08T05:00:17Z","snapshot_observed_at":"2026-08-06T19:17:57.988428Z","submitted_at":"2025-07-08T05:00:17Z","title":"LiON-LoRA: Rethinking LoRA Fusion to Unify Controllable Spatial and Temporal Generation for Video Diffusion","version":1},"reference_index":91,"source":"pdf_text","source_observed_at":"2026-08-06T19:25:28.576427Z"},"links":{"citing_paper":"/paper/2507.05678"},"observation_digest":"sha256:bd64fa2086afc6c7a85f999a6247c36d9b2760908838c1c79c9577bcfacf01ff","observation_id":"34aab84b-58ea-4e2d-9ddc-ad434d1e9b87","resolution":{"observed_at":"2026-08-06T19:25:31.778486Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:25:31.555896Z","title":"Dreamvideo: Composing your dream videos with customized subject and motion","venue":null,"work_id":"d074e16d-fa20-4dad-a038-3ee4442615f8","year":2024},"citing_paper":{"arxiv_id":"2507.05678","last_updated":"2025-07-08T05:00:17Z","snapshot_observed_at":"2026-08-06T19:17:57.988428Z","submitted_at":"2025-07-08T05:00:17Z","title":"LiON-LoRA: Rethinking LoRA Fusion to Unify Controllable Spatial and Temporal Generation for Video Diffusion","version":1},"reference_index":92,"source":"pdf_text","source_observed_at":"2026-08-06T19:25:28.581016Z"},"links":{"citing_paper":"/paper/2507.05678"},"observation_digest":"sha256:b9dcf30df86d193f4e6731a01613a5b11cfbe824587897b6fb807041053dd209","observation_id":"3bbb9efe-b297-427e-8a10-5ea234eef09c","resolution":{"observed_at":"2026-08-06T19:25:31.601048Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2406.17758","last_updated":"2024-10-29T11:56:27Z","snapshot_observed_at":"2026-08-16T13:50:54.724883Z","submitted_at":"2024-06-25T17:42:25Z","title":"MotionBooth: Motion-Aware Customized Text-to-Video Generation","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2406.17758","snapshot_observed_at":"2026-08-06T19:25:28.587239Z","title":"Motionbooth: Motion-aware customized text-to- video generation","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.05678","last_updated":"2025-07-08T05:00:17Z","snapshot_observed_at":"2026-08-06T19:17:57.988428Z","submitted_at":"2025-07-08T05:00:17Z","title":"LiON-LoRA: Rethinking LoRA Fusion to Unify Controllable Spatial and Temporal Generation for Video Diffusion","version":1},"reference_index":93,"source":"pdf_text","source_observed_at":"2026-08-06T19:25:28.587239Z"},"links":{"cited_paper":"/paper/2406.17758","citing_paper":"/paper/2507.05678"},"observation_digest":"sha256:6a22a7b7c493d1a667eaae4636d5760372fd574ffe3b029f4bebc82dd0137b8f","observation_id":"35cbd15c-cd64-46a2-81bf-f4de539d0907","resolution":{"observed_at":"2026-08-06T19:25:28.587239Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:25:28.595414Z","title":"Tune-a-video: One-shot tuning of image diffusion models for text-to-video generation","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2507.05678","last_updated":"2025-07-08T05:00:17Z","snapshot_observed_at":"2026-08-06T19:17:57.988428Z","submitted_at":"2025-07-08T05:00:17Z","title":"LiON-LoRA: Rethinking LoRA Fusion to Unify Controllable Spatial and Temporal Generation for Video Diffusion","version":1},"reference_index":94,"source":"pdf_text","source_observed_at":"2026-08-06T19:25:28.595414Z"},"links":{"citing_paper":"/paper/2507.05678"},"observation_digest":"sha256:31d4c20abfefabeb8991703b831be23ca9a508ef0ba1f9aab777a8d6ffe12a8d","observation_id":"34073bb9-765c-400f-b380-a7bc307973ec","resolution":{"observed_at":"2026-08-06T19:25:28.595414Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:25:31.373036Z","title":"Spherediffusion: Spherical geometry-aware distortion resilient diffusion model","venue":null,"work_id":"281f0b26-6bac-495e-ba34-a8610befde92","year":2024},"citing_paper":{"arxiv_id":"2507.05678","last_updated":"2025-07-08T05:00:17Z","snapshot_observed_at":"2026-08-06T19:17:57.988428Z","submitted_at":"2025-07-08T05:00:17Z","title":"LiON-LoRA: Rethinking LoRA Fusion to Unify Controllable Spatial and Temporal Generation for Video Diffusion","version":1},"reference_index":95,"source":"pdf_text","source_observed_at":"2026-08-06T19:25:28.601496Z"},"links":{"citing_paper":"/paper/2507.05678"},"observation_digest":"sha256:269dc581bc620e3f74e3c9f67f7173b3f1958c78eade0129bee45b91c5e73a08","observation_id":"79e1ffb1-8477-4e1a-93d3-516736898600","resolution":{"observed_at":"2026-08-06T19:25:31.465298Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2408.13239","last_updated":"2024-12-27T13:58:39Z","snapshot_observed_at":"2026-08-16T13:51:56.014897Z","submitted_at":"2024-08-23T17:26:06Z","title":"CustomCrafter: Customized Video Generation with Preserving Motion and Concept Composition Abilities","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2408.13239","snapshot_observed_at":"2026-08-06T19:25:28.606305Z","title":"Customcrafter: Customized video generation with pre- serving motion and concept composition abilities","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.05678","last_updated":"2025-07-08T05:00:17Z","snapshot_observed_at":"2026-08-06T19:17:57.988428Z","submitted_at":"2025-07-08T05:00:17Z","title":"LiON-LoRA: Rethinking LoRA Fusion to Unify Controllable Spatial and Temporal Generation for Video Diffusion","version":1},"reference_index":96,"source":"pdf_text","source_observed_at":"2026-08-06T19:25:28.606305Z"},"links":{"cited_paper":"/paper/2408.13239","citing_paper":"/paper/2507.05678"},"observation_digest":"sha256:26f0d09ea1c2db5918d187d7d1b886a2b1b7c7076053096b8e34e414c0cf49cc","observation_id":"0677294d-f440-4c04-a91c-5c05305f1206","resolution":{"observed_at":"2026-08-06T19:25:28.606305Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:25:31.240211Z","title":"Draganything: Motion control for any- thing using entity representation","venue":null,"work_id":"ef608817-88ee-4dc0-905c-f9ac93abb5f6","year":2024},"citing_paper":{"arxiv_id":"2507.05678","last_updated":"2025-07-08T05:00:17Z","snapshot_observed_at":"2026-08-06T19:17:57.988428Z","submitted_at":"2025-07-08T05:00:17Z","title":"LiON-LoRA: Rethinking LoRA Fusion to Unify Controllable Spatial and Temporal Generation for Video Diffusion","version":1},"reference_index":97,"source":"pdf_text","source_observed_at":"2026-08-06T19:25:28.613022Z"},"links":{"citing_paper":"/paper/2507.05678"},"observation_digest":"sha256:8715cd130c3f377893262878d1541c06350ae0c1a22dfb68488ca58615705959","observation_id":"48ca9f1f-4b19-4b22-aa66-fb79b7058d64","resolution":{"observed_at":"2026-08-06T19:25:31.292623Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2409.08240","last_updated":"2024-11-06T13:03:20Z","snapshot_observed_at":"2026-08-16T13:19:03.280787Z","submitted_at":"2024-09-12T17:39:23Z","title":"IFAdapter: Instance Feature Control for Grounded Text-to-Image Generation","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2409.08240","snapshot_observed_at":"2026-08-06T19:25:28.620707Z","title":"Ifadapter: Instance feature con- trol for grounded text-to-image generation","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.05678","last_updated":"2025-07-08T05:00:17Z","snapshot_observed_at":"2026-08-06T19:17:57.988428Z","submitted_at":"2025-07-08T05:00:17Z","title":"LiON-LoRA: Rethinking LoRA Fusion to Unify Controllable Spatial and Temporal Generation for Video Diffusion","version":1},"reference_index":98,"source":"pdf_text","source_observed_at":"2026-08-06T19:25:28.620707Z"},"links":{"cited_paper":"/paper/2409.08240","citing_paper":"/paper/2507.05678"},"observation_digest":"sha256:24b71f35b89061e740144f847f0cbdda1c1c0b279184a2ed8cd5dec26838bdd6","observation_id":"9718f27c-7aeb-4f3a-811a-0e272c817403","resolution":{"observed_at":"2026-08-06T19:25:28.620707Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:25:31.063414Z","title":"Dynamicrafter: Animating open-domain images with video diffusion priors","venue":null,"work_id":"f69ce5c6-49a9-44f0-b957-b1a5a305da7f","year":2024},"citing_paper":{"arxiv_id":"2507.05678","last_updated":"2025-07-08T05:00:17Z","snapshot_observed_at":"2026-08-06T19:17:57.988428Z","submitted_at":"2025-07-08T05:00:17Z","title":"LiON-LoRA: Rethinking LoRA Fusion to Unify Controllable Spatial and Temporal Generation for Video Diffusion","version":1},"reference_index":99,"source":"pdf_text","source_observed_at":"2026-08-06T19:25:28.625464Z"},"links":{"citing_paper":"/paper/2507.05678"},"observation_digest":"sha256:62f1d3d1e42c6dd30f2617b292cde7ea59fcef1a75f4bd7d6c17f0acc6205b68","observation_id":"29824997-39ab-4337-868a-0a5b419beeba","resolution":{"observed_at":"2026-08-06T19:25:31.138312Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2406.02509","last_updated":"2024-06-04T17:27:19Z","snapshot_observed_at":"2026-08-04T13:02:12.217544Z","submitted_at":"2024-06-04T17:27:19Z","title":"CamCo: Camera-Controllable 3D-Consistent Image-to-Video Generation","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2406.02509","snapshot_observed_at":"2026-08-06T19:25:28.637654Z","title":"Camco: Camera-controllable 3d-consistent image-to-video genera- tion","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.05678","last_updated":"2025-07-08T05:00:17Z","snapshot_observed_at":"2026-08-06T19:17:57.988428Z","submitted_at":"2025-07-08T05:00:17Z","title":"LiON-LoRA: Rethinking LoRA Fusion to Unify Controllable Spatial and Temporal Generation for Video Diffusion","version":1},"reference_index":101,"source":"pdf_text","source_observed_at":"2026-08-06T19:25:28.637654Z"},"links":{"cited_paper":"/paper/2406.02509","citing_paper":"/paper/2507.05678"},"observation_digest":"sha256:12167f7c96a486672c8786481b92f152bf8568c710ad79c2b6950f89117f4b1a","observation_id":"2f9020d9-57ba-4813-a6be-d152ec65d6dd","resolution":{"observed_at":"2026-08-06T19:25:28.637654Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:25:30.921225Z","title":"Magicanimate: Temporally consistent human image animation using diffusion model","venue":null,"work_id":"8a3ed5b4-7b82-45fe-8cd9-4d555af77246","year":2024},"citing_paper":{"arxiv_id":"2507.05678","last_updated":"2025-07-08T05:00:17Z","snapshot_observed_at":"2026-08-06T19:17:57.988428Z","submitted_at":"2025-07-08T05:00:17Z","title":"LiON-LoRA: Rethinking LoRA Fusion to Unify Controllable Spatial and Temporal Generation for Video Diffusion","version":1},"reference_index":102,"source":"pdf_text","source_observed_at":"2026-08-06T19:25:28.645155Z"},"links":{"citing_paper":"/paper/2507.05678"},"observation_digest":"sha256:4cb6c516bf17999113415b1bb08263411e895169716b645a8fd2afa3008f3710","observation_id":"275117c1-dc71-4acb-82c9-391a9d955932","resolution":{"observed_at":"2026-08-06T19:25:30.985323Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}}],"paper":{"arxiv_id":"2507.05678","last_updated":"2025-07-08T05:00:17Z","latest_version":1,"primary_category":"cs.CV","snapshot_observed_at":"2026-08-06T19:17:57.988428Z","submitted_at":"2025-07-08T05:00:17Z","title":"LiON-LoRA: Rethinking LoRA Fusion to Unify Controllable Spatial and Temporal Generation for Video Diffusion"},"reference_resolution":{"displayed":100,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":82,"verified_exact":1,"verified_fuzzy":17},"total_outbound_references":121},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"thesis":"As of 21 August 2026, this Paper Citation Record lists 100 of 121 outbound references and 0 inbound Pith citation observations for arXiv:2507.05678."}