{"as_of":"2026-08-17T07:34:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:60bf3ac4ccc637f3b8d48a789af186fa3e92c982edec5640051c7ff417ef0f72","coverage":[{"denominator":49,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":49,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-10T11:17:24.903509Z","state":"measured"},{"denominator":50,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":50,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-17T06:30:58.91139+00:00","state":"measured"},{"denominator":1,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":1,"source":"paper_references, paper_reference_links","source_observed_at":"2026-05-19T07:25:41.219753Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"arxiv_reference","source_observed_at":"2026-05-19T07:27:09.000021Z","state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2501.16714","last_updated":"2025-09-07T04:06:42Z","snapshot_observed_at":"2026-08-15T08:13:22.977904Z","submitted_at":"2025-01-28T05:40:20Z","title":"Separate Motion from Appearance: Customizing Motion via Customizing Text-to-Video Diffusion Models","version":2},"cited_work":{"arxiv_id":"2501.16714","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2501.16714","snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Separate motion from appear- ance: Customizing motion via customizing text-to-video diffusion models","venue":null,"work_id":"9202a2ec-5626-4696-a0de-5332bbff8bce","year":2025},"citing_paper":{"arxiv_id":"2506.19840","last_updated":"2026-04-16T20:25:04Z","snapshot_observed_at":"2026-08-16T01:01:22.391755Z","submitted_at":"2025-06-24T17:58:04Z","title":"GenHSI: Controllable Generation of Human-Scene Interaction Videos","version":2},"reference_index":56,"source":"pdf_text","source_observed_at":"2026-05-19T07:25:41.219753Z"},"links":{"cited_paper":"/paper/2501.16714","citing_paper":"/paper/2506.19840"},"observation_digest":"sha256:d2270576522258a7e7428b0e029f1ee983fa8290286b131fca93d1e59b9bca06","observation_id":"5f29e41d-f228-456c-88b1-cfec2d8fa30f","resolution":{"observed_at":"2026-05-19T07:27:09.001999Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}}],"links":{"evidence":"/evidence","html":"/paper/2501.16714/citation-record","integrity":"/paper/2501.16714/integrity","json":"/paper/2501.16714/citation-record.json","paper":"/paper/2501.16714"},"outbound":[{"citation":{"cited_paper":{"arxiv_id":"2304.08477","last_updated":"2023-04-18T03:27:52Z","snapshot_observed_at":"2026-08-16T15:39:48.920549Z","submitted_at":"2023-04-17T17:57:06Z","title":"Latent-Shift: Latent Diffusion with Temporal Shift for Efficient Text-to-Video Generation","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2304.08477","snapshot_observed_at":"2026-08-10T11:17:24.716992Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2501.16714","last_updated":"2025-09-07T04:06:42Z","snapshot_observed_at":"2026-08-15T08:13:22.977904Z","submitted_at":"2025-01-28T05:40:20Z","title":"Separate Motion from Appearance: Customizing Motion via Customizing Text-to-Video Diffusion Models","version":2},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-10T11:17:24.716992Z"},"links":{"cited_paper":"/paper/2304.08477","citing_paper":"/paper/2501.16714"},"observation_digest":"sha256:e46780c597901b5241e351ec84c06a228de2762dc562d3cd9cc2060a80c9a315","observation_id":"ad7f1e2a-4252-427b-a6df-8b5776f895bd","resolution":{"observed_at":"2026-08-10T11:17:24.716992Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":"10.24963/ijcai.2019/276","metadata_source":"doi_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T11:17:24.929925Z","title":null,"venue":null,"work_id":"a041b10f-6cc0-4694-8ba7-1be75e538ebc","year":2019},"citing_paper":{"arxiv_id":"2501.16714","last_updated":"2025-09-07T04:06:42Z","snapshot_observed_at":"2026-08-15T08:13:22.977904Z","submitted_at":"2025-01-28T05:40:20Z","title":"Separate Motion from Appearance: Customizing Motion via Customizing Text-to-Video Diffusion Models","version":2},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-10T11:17:24.721436Z"},"links":{"citing_paper":"/paper/2501.16714"},"observation_digest":"sha256:a4558760417b98c32ff6b7945a442e7087bacd821c1195cda4b8dec26d80a3e3","observation_id":"61ceccf2-ca3e-4887-a4b5-29e859291702","resolution":{"observed_at":"2026-08-10T11:17:24.935013Z","resolver_source":"doi","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2311.15127","last_updated":"2023-11-25T22:28:38Z","snapshot_observed_at":"2026-08-16T12:52:49.101262Z","submitted_at":"2023-11-25T22:28:38Z","title":"Stable Video Diffusion: Scaling Latent Video Diffusion Models to Large Datasets","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2311.15127","snapshot_observed_at":"2026-08-10T11:17:24.725361Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2501.16714","last_updated":"2025-09-07T04:06:42Z","snapshot_observed_at":"2026-08-15T08:13:22.977904Z","submitted_at":"2025-01-28T05:40:20Z","title":"Separate Motion from Appearance: Customizing Motion via Customizing Text-to-Video Diffusion Models","version":2},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-10T11:17:24.725361Z"},"links":{"cited_paper":"/paper/2311.15127","citing_paper":"/paper/2501.16714"},"observation_digest":"sha256:a545182ada83a7ba149963713d17fd82a2c1b39da76902bfde3f33a7eb2ab4bf","observation_id":"a6e6128d-7135-4657-b0a2-29aab04e3505","resolution":{"observed_at":"2026-08-10T11:17:24.725361Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T11:17:25.407115Z","title":null,"venue":null,"work_id":"df66f7d4-17dd-4ac1-8a79-bd946ff110de","year":2023},"citing_paper":{"arxiv_id":"2501.16714","last_updated":"2025-09-07T04:06:42Z","snapshot_observed_at":"2026-08-15T08:13:22.977904Z","submitted_at":"2025-01-28T05:40:20Z","title":"Separate Motion from Appearance: Customizing Motion via Customizing Text-to-Video Diffusion Models","version":2},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-10T11:17:24.729581Z"},"links":{"citing_paper":"/paper/2501.16714"},"observation_digest":"sha256:8084d2c09089e56092477bfbd90ee3a8dcefa791c9e48be32cc81c68709b8077","observation_id":"8d118574-d596-42b7-b080-f52397ffaad1","resolution":{"observed_at":"2026-08-10T11:17:25.410757Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T11:17:24.733141Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2501.16714","last_updated":"2025-09-07T04:06:42Z","snapshot_observed_at":"2026-08-15T08:13:22.977904Z","submitted_at":"2025-01-28T05:40:20Z","title":"Separate Motion from Appearance: Customizing Motion via Customizing Text-to-Video Diffusion Models","version":2},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-10T11:17:24.733141Z"},"links":{"citing_paper":"/paper/2501.16714"},"observation_digest":"sha256:d408be3ce5ba146750c79809857e2ead74f5bf6b1f919ae2dc2f91188eb731c5","observation_id":"a0481817-f1df-4f05-9cfd-c858b7d0c771","resolution":{"observed_at":"2026-08-10T11:17:24.733141Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T11:17:25.388793Z","title":null,"venue":null,"work_id":"e09f6248-4265-4860-b9f9-391778ed30c0","year":2023},"citing_paper":{"arxiv_id":"2501.16714","last_updated":"2025-09-07T04:06:42Z","snapshot_observed_at":"2026-08-15T08:13:22.977904Z","submitted_at":"2025-01-28T05:40:20Z","title":"Separate Motion from Appearance: Customizing Motion via Customizing Text-to-Video Diffusion Models","version":2},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-10T11:17:24.736786Z"},"links":{"citing_paper":"/paper/2501.16714"},"observation_digest":"sha256:4a04ea38188f35ffaed9ceca697bbf27345979cdf6967f2a0795cebccf782f9e","observation_id":"da6fc8be-d217-489d-9261-d89027a9fb99","resolution":{"observed_at":"2026-08-10T11:17:25.393061Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2305.13840","last_updated":"2024-08-12T08:30:05Z","snapshot_observed_at":"2026-08-16T15:30:44.303194Z","submitted_at":"2023-05-23T09:03:19Z","title":"Control-A-Video: Controllable Text-to-Video Diffusion Models with Motion Prior and Reward Feedback Learning","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2305.13840","snapshot_observed_at":"2026-08-10T11:17:24.740435Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2501.16714","last_updated":"2025-09-07T04:06:42Z","snapshot_observed_at":"2026-08-15T08:13:22.977904Z","submitted_at":"2025-01-28T05:40:20Z","title":"Separate Motion from Appearance: Customizing Motion via Customizing Text-to-Video Diffusion Models","version":2},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-10T11:17:24.740435Z"},"links":{"cited_paper":"/paper/2305.13840","citing_paper":"/paper/2501.16714"},"observation_digest":"sha256:2daff1b8e8e8353c840e65559e6a0d5194c68f4ae33a566fc69067ea7a2df2d4","observation_id":"ad45eb0c-e1c2-46d8-9716-2eb1cc99efbc","resolution":{"observed_at":"2026-08-10T11:17:24.740435Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T11:17:25.377040Z","title":null,"venue":null,"work_id":"2dc83432-27fc-413f-baad-dccbcaf5ffb8","year":2016},"citing_paper":{"arxiv_id":"2501.16714","last_updated":"2025-09-07T04:06:42Z","snapshot_observed_at":"2026-08-15T08:13:22.977904Z","submitted_at":"2025-01-28T05:40:20Z","title":"Separate Motion from Appearance: Customizing Motion via Customizing Text-to-Video Diffusion Models","version":2},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-10T11:17:24.744358Z"},"links":{"citing_paper":"/paper/2501.16714"},"observation_digest":"sha256:0919236e2b90f82fe811af378bdd6c9230fb1d5e3d2bc261c74491a4823fe642","observation_id":"b32d2c54-5cf4-4e9b-b5d4-a229e7c43a1a","resolution":{"observed_at":"2026-08-10T11:17:25.380908Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T11:17:25.366062Z","title":null,"venue":null,"work_id":"d7a79a48-aa76-4d02-8674-8c88a3035395","year":2023},"citing_paper":{"arxiv_id":"2501.16714","last_updated":"2025-09-07T04:06:42Z","snapshot_observed_at":"2026-08-15T08:13:22.977904Z","submitted_at":"2025-01-28T05:40:20Z","title":"Separate Motion from Appearance: Customizing Motion via Customizing Text-to-Video Diffusion Models","version":2},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-10T11:17:24.747808Z"},"links":{"citing_paper":"/paper/2501.16714"},"observation_digest":"sha256:7623abd66d5fc3192dee58356d2887dc5a35626d56dbe03e6690268949914ad5","observation_id":"1304b929-9e51-4aaa-950c-0cb567d6c633","resolution":{"observed_at":"2026-08-10T11:17:25.369699Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2204.03638","last_updated":"2022-09-24T20:49:24Z","snapshot_observed_at":"2026-08-16T17:08:29.732791Z","submitted_at":"2022-04-07T17:59:02Z","title":"Long Video Generation with Time-Agnostic VQGAN and Time-Sensitive Transformer","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2204.03638","snapshot_observed_at":"2026-08-10T11:17:24.751477Z","title":null,"venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2501.16714","last_updated":"2025-09-07T04:06:42Z","snapshot_observed_at":"2026-08-15T08:13:22.977904Z","submitted_at":"2025-01-28T05:40:20Z","title":"Separate Motion from Appearance: Customizing Motion via Customizing Text-to-Video Diffusion Models","version":2},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-10T11:17:24.751477Z"},"links":{"cited_paper":"/paper/2204.03638","citing_paper":"/paper/2501.16714"},"observation_digest":"sha256:68c6288ee9e08e7ecfebba18356049385d16c4770b745879df40a76b9e11ea4d","observation_id":"08a1bc57-c39a-47f3-943f-1c15b1c1d9e3","resolution":{"observed_at":"2026-08-10T11:17:24.751477Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2307.10373","last_updated":"2023-11-20T10:54:09Z","snapshot_observed_at":"2026-08-15T03:17:05.670808Z","submitted_at":"2023-07-19T18:00:03Z","title":"TokenFlow: Consistent Diffusion Features for Consistent Video Editing","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2307.10373","snapshot_observed_at":"2026-08-10T11:17:24.755854Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2501.16714","last_updated":"2025-09-07T04:06:42Z","snapshot_observed_at":"2026-08-15T08:13:22.977904Z","submitted_at":"2025-01-28T05:40:20Z","title":"Separate Motion from Appearance: Customizing Motion via Customizing Text-to-Video Diffusion Models","version":2},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-10T11:17:24.755854Z"},"links":{"cited_paper":"/paper/2307.10373","citing_paper":"/paper/2501.16714"},"observation_digest":"sha256:071b7ed0ae59c31b0679ff23a030294bcff97307b9b0f75183127c498072eac3","observation_id":"340180da-2218-433c-9309-841462e264b2","resolution":{"observed_at":"2026-08-10T11:17:24.755854Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2307.04725","last_updated":"2024-02-08T18:08:57Z","snapshot_observed_at":"2026-08-12T14:50:50.360929Z","submitted_at":"2023-07-10T17:34:16Z","title":"AnimateDiff: Animate Your Personalized Text-to-Image Diffusion Models without Specific Tuning","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2307.04725","snapshot_observed_at":"2026-08-10T11:17:24.759958Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2501.16714","last_updated":"2025-09-07T04:06:42Z","snapshot_observed_at":"2026-08-15T08:13:22.977904Z","submitted_at":"2025-01-28T05:40:20Z","title":"Separate Motion from Appearance: Customizing Motion via Customizing Text-to-Video Diffusion Models","version":2},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-10T11:17:24.759958Z"},"links":{"cited_paper":"/paper/2307.04725","citing_paper":"/paper/2501.16714"},"observation_digest":"sha256:644b8c16eeb4911de865ff6b85eecd33db0f9f8271de14489ccdba36c81b74b4","observation_id":"445a7ea7-14ee-4961-b479-f35071e3cd39","resolution":{"observed_at":"2026-08-10T11:17:24.759958Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2210.02303","last_updated":"2022-10-05T14:41:38Z","snapshot_observed_at":"2026-07-06T13:59:57.800591Z","submitted_at":"2022-10-05T14:41:38Z","title":"Imagen Video: High Definition Video Generation with Diffusion Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2210.02303","snapshot_observed_at":"2026-08-10T11:17:24.763980Z","title":null,"venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2501.16714","last_updated":"2025-09-07T04:06:42Z","snapshot_observed_at":"2026-08-15T08:13:22.977904Z","submitted_at":"2025-01-28T05:40:20Z","title":"Separate Motion from Appearance: Customizing Motion via Customizing Text-to-Video Diffusion Models","version":2},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-10T11:17:24.763980Z"},"links":{"cited_paper":"/paper/2210.02303","citing_paper":"/paper/2501.16714"},"observation_digest":"sha256:eb7371b241f8034a00078cc7fb652dc3107b940f9d58c4d19945f4e87f298e71","observation_id":"bc0adb3a-c2a4-4c65-a64d-b534cceaa7e3","resolution":{"observed_at":"2026-08-10T11:17:24.763980Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T11:17:24.768234Z","title":null,"venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2501.16714","last_updated":"2025-09-07T04:06:42Z","snapshot_observed_at":"2026-08-15T08:13:22.977904Z","submitted_at":"2025-01-28T05:40:20Z","title":"Separate Motion from Appearance: Customizing Motion via Customizing Text-to-Video Diffusion Models","version":2},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-10T11:17:24.768234Z"},"links":{"citing_paper":"/paper/2501.16714"},"observation_digest":"sha256:fd91b57d27b4520ff7ba1db49a88925c9143697531ca4523f44947f92ff6665e","observation_id":"97a54076-6c1a-4e8e-92c3-dfd00cccd9b3","resolution":{"observed_at":"2026-08-10T11:17:24.768234Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2205.15868","last_updated":"2022-05-29T19:02:15Z","snapshot_observed_at":"2026-08-12T19:21:15.526321Z","submitted_at":"2022-05-29T19:02:15Z","title":"CogVideo: Large-scale Pretraining for Text-to-Video Generation via Transformers","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2205.15868","snapshot_observed_at":"2026-08-10T11:17:24.771671Z","title":null,"venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2501.16714","last_updated":"2025-09-07T04:06:42Z","snapshot_observed_at":"2026-08-15T08:13:22.977904Z","submitted_at":"2025-01-28T05:40:20Z","title":"Separate Motion from Appearance: Customizing Motion via Customizing Text-to-Video Diffusion Models","version":2},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-10T11:17:24.771671Z"},"links":{"cited_paper":"/paper/2205.15868","citing_paper":"/paper/2501.16714"},"observation_digest":"sha256:d7c7856a3e601a20d37344a127c34a00d8ff7a47ccbb0420b2d96adc8dc9cf7d","observation_id":"0048a63c-e256-4ea6-98ce-3d561b9747d6","resolution":{"observed_at":"2026-08-10T11:17:24.771671Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T11:17:25.349840Z","title":null,"venue":null,"work_id":"94439a9f-5f64-47de-bc51-8bcce78ef25b","year":null},"citing_paper":{"arxiv_id":"2501.16714","last_updated":"2025-09-07T04:06:42Z","snapshot_observed_at":"2026-08-15T08:13:22.977904Z","submitted_at":"2025-01-28T05:40:20Z","title":"Separate Motion from Appearance: Customizing Motion via Customizing Text-to-Video Diffusion Models","version":2},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-10T11:17:24.775620Z"},"links":{"citing_paper":"/paper/2501.16714"},"observation_digest":"sha256:5cdd97a55697752e39c979c94ea6628350d030f12a7f98b280e6c020764b19f3","observation_id":"f69ca729-401c-4ee7-866a-fc22019495d0","resolution":{"observed_at":"2026-08-10T11:17:25.353317Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T11:17:24.782768Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2501.16714","last_updated":"2025-09-07T04:06:42Z","snapshot_observed_at":"2026-08-15T08:13:22.977904Z","submitted_at":"2025-01-28T05:40:20Z","title":"Separate Motion from Appearance: Customizing Motion via Customizing Text-to-Video Diffusion Models","version":2},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-10T11:17:24.782768Z"},"links":{"citing_paper":"/paper/2501.16714"},"observation_digest":"sha256:5fd681ee6d51d49bc471797d48caf03cc2b2a9541ed30c2fabd9f21b031c568a","observation_id":"87adc961-1d8f-4e2c-9c29-d6893d273a19","resolution":{"observed_at":"2026-08-10T11:17:24.782768Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T11:17:25.323320Z","title":null,"venue":null,"work_id":"42daf557-f36f-4f55-8ab1-5ee87ff3af7e","year":2024},"citing_paper":{"arxiv_id":"2501.16714","last_updated":"2025-09-07T04:06:42Z","snapshot_observed_at":"2026-08-15T08:13:22.977904Z","submitted_at":"2025-01-28T05:40:20Z","title":"Separate Motion from Appearance: Customizing Motion via Customizing Text-to-Video Diffusion Models","version":2},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-10T11:17:24.786865Z"},"links":{"citing_paper":"/paper/2501.16714"},"observation_digest":"sha256:50fa1fbf03b177e978b76627510904367b99e6e2d88ce6e484613928cd54efb5","observation_id":"d0f7e956-d73b-46a2-8707-6d72d2e3995b","resolution":{"observed_at":"2026-08-10T11:17:25.326812Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2303.13439","last_updated":"2023-03-23T17:01:59Z","snapshot_observed_at":"2026-08-16T15:45:51.619614Z","submitted_at":"2023-03-23T17:01:59Z","title":"Text2Video-Zero: Text-to-Image Diffusion Models are Zero-Shot Video Generators","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2303.13439","snapshot_observed_at":"2026-08-10T11:17:24.790436Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2501.16714","last_updated":"2025-09-07T04:06:42Z","snapshot_observed_at":"2026-08-15T08:13:22.977904Z","submitted_at":"2025-01-28T05:40:20Z","title":"Separate Motion from Appearance: Customizing Motion via Customizing Text-to-Video Diffusion Models","version":2},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-10T11:17:24.790436Z"},"links":{"cited_paper":"/paper/2303.13439","citing_paper":"/paper/2501.16714"},"observation_digest":"sha256:10078fdb60a0e460900cee47b77556c3097560a89e2c31da4e5e3423b18cc0d6","observation_id":"9b90ddee-ad18-43ca-8a26-de9d0a18f955","resolution":{"observed_at":"2026-08-10T11:17:24.790436Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T11:17:25.311924Z","title":null,"venue":null,"work_id":"a648f35a-390a-4cbe-861f-3eb94bc3a5d2","year":2023},"citing_paper":{"arxiv_id":"2501.16714","last_updated":"2025-09-07T04:06:42Z","snapshot_observed_at":"2026-08-15T08:13:22.977904Z","submitted_at":"2025-01-28T05:40:20Z","title":"Separate Motion from Appearance: Customizing Motion via Customizing Text-to-Video Diffusion Models","version":2},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-10T11:17:24.794465Z"},"links":{"citing_paper":"/paper/2501.16714"},"observation_digest":"sha256:21de8a3c99660cf1595810fdefac38c7d2fae4485922abbcabd8779d8dd86ba1","observation_id":"93464f84-44f6-4507-90c6-60d99139d605","resolution":{"observed_at":"2026-08-10T11:17:25.315972Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2107.08037","last_updated":"2021-10-26T17:45:36Z","snapshot_observed_at":"2026-08-16T18:09:29.335337Z","submitted_at":"2021-07-16T17:57:44Z","title":"CCVS: Context-aware Controllable Video Synthesis","version":2},"cited_work":{"arxiv_id":"2107.08037","doi":null,"metadata_source":"pith","pith_arxiv_id":"2107.08037","snapshot_observed_at":"2026-08-10T11:17:25.077550Z","title":"CCVS: Context-aware Controllable Video Synthesis","venue":"cs.CV","work_id":"8ea1c97e-8fb5-43e9-8997-09e7e11176cf","year":2021},"citing_paper":{"arxiv_id":"2501.16714","last_updated":"2025-09-07T04:06:42Z","snapshot_observed_at":"2026-08-15T08:13:22.977904Z","submitted_at":"2025-01-28T05:40:20Z","title":"Separate Motion from Appearance: Customizing Motion via Customizing Text-to-Video Diffusion Models","version":2},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-10T11:17:24.798016Z"},"links":{"cited_paper":"/paper/2107.08037","citing_paper":"/paper/2501.16714"},"observation_digest":"sha256:2dd2cced50f0e5ca088e8ca0a23f32b7802a5dc5f76a6eb48c34e52c4abf2e1c","observation_id":"3b18f5b5-e233-40e2-978a-75b4ac4d4346","resolution":{"observed_at":"2026-08-10T11:17:25.081647Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T11:17:24.801805Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2501.16714","last_updated":"2025-09-07T04:06:42Z","snapshot_observed_at":"2026-08-15T08:13:22.977904Z","submitted_at":"2025-01-28T05:40:20Z","title":"Separate Motion from Appearance: Customizing Motion via Customizing Text-to-Video Diffusion Models","version":2},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-10T11:17:24.801805Z"},"links":{"citing_paper":"/paper/2501.16714"},"observation_digest":"sha256:af5a47398101689e5292adfde259265e5bd77899b4bf3f2c85736941fd0b29da","observation_id":"aab212cf-d9a0-4e96-9d0a-4c82f379aa1f","resolution":{"observed_at":"2026-08-10T11:17:24.801805Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T11:17:24.805507Z","title":null,"venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2501.16714","last_updated":"2025-09-07T04:06:42Z","snapshot_observed_at":"2026-08-15T08:13:22.977904Z","submitted_at":"2025-01-28T05:40:20Z","title":"Separate Motion from Appearance: Customizing Motion via Customizing Text-to-Video Diffusion Models","version":2},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-10T11:17:24.805507Z"},"links":{"citing_paper":"/paper/2501.16714"},"observation_digest":"sha256:4637661b9ad6d1284f251a50405e0437e63f2a875fc4e9f4ebfc049a21b015b0","observation_id":"943063ba-1ee3-4462-a2d4-c0df3570d0b2","resolution":{"observed_at":"2026-08-10T11:17:24.805507Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2402.14780","last_updated":"2024-08-28T01:13:44Z","snapshot_observed_at":"2026-08-16T14:16:08.555625Z","submitted_at":"2024-02-22T18:38:48Z","title":"Customize-A-Video: One-Shot Motion Customization of Text-to-Video Diffusion Models","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.14780","snapshot_observed_at":"2026-08-10T11:17:24.809060Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2501.16714","last_updated":"2025-09-07T04:06:42Z","snapshot_observed_at":"2026-08-15T08:13:22.977904Z","submitted_at":"2025-01-28T05:40:20Z","title":"Separate Motion from Appearance: Customizing Motion via Customizing Text-to-Video Diffusion Models","version":2},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-10T11:17:24.809060Z"},"links":{"cited_paper":"/paper/2402.14780","citing_paper":"/paper/2501.16714"},"observation_digest":"sha256:c841668ba631aca8bf18d77d89417066c793620801bc8c4a499b62a6a3a218ee","observation_id":"029edbbf-bb42-46a8-a2f0-8e4ff213697e","resolution":{"observed_at":"2026-08-10T11:17:24.809060Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T11:17:25.285845Z","title":null,"venue":null,"work_id":"dd08c498-6272-49df-be2c-72a86313b7d8","year":2008},"citing_paper":{"arxiv_id":"2501.16714","last_updated":"2025-09-07T04:06:42Z","snapshot_observed_at":"2026-08-15T08:13:22.977904Z","submitted_at":"2025-01-28T05:40:20Z","title":"Separate Motion from Appearance: Customizing Motion via Customizing Text-to-Video Diffusion Models","version":2},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-08-10T11:17:24.813104Z"},"links":{"citing_paper":"/paper/2501.16714"},"observation_digest":"sha256:bcef597e0e64e3a7ee368d1cba75ea8490c3dc901cfadf5e138916fdf1e8599f","observation_id":"f4e875c1-b4a7-405d-8c7d-9390a7ad85f3","resolution":{"observed_at":"2026-08-10T11:17:25.289508Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T11:17:24.816691Z","title":null,"venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2501.16714","last_updated":"2025-09-07T04:06:42Z","snapshot_observed_at":"2026-08-15T08:13:22.977904Z","submitted_at":"2025-01-28T05:40:20Z","title":"Separate Motion from Appearance: Customizing Motion via Customizing Text-to-Video Diffusion Models","version":2},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-08-10T11:17:24.816691Z"},"links":{"citing_paper":"/paper/2501.16714"},"observation_digest":"sha256:693408726e5874934269a1f5b33ab745f9be8e12feedb26b5ad0a1128d635119","observation_id":"f405fccc-477f-4fe8-9d92-7776899d0312","resolution":{"observed_at":"2026-08-10T11:17:24.816691Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2304.02777","last_updated":"2023-04-05T22:47:12Z","snapshot_observed_at":"2026-08-16T15:42:25.090114Z","submitted_at":"2023-04-05T22:47:12Z","title":"MoStGAN-V: Video Generation with Temporal Motion Styles","version":1},"cited_work":{"arxiv_id":"2304.02777","doi":null,"metadata_source":"pith","pith_arxiv_id":"2304.02777","snapshot_observed_at":"2026-08-10T11:17:25.049528Z","title":"MoStGAN-V: Video Generation with Temporal Motion Styles","venue":"cs.CV","work_id":"c5f0b8a7-556f-45da-b0d8-d6ed5134034e","year":2023},"citing_paper":{"arxiv_id":"2501.16714","last_updated":"2025-09-07T04:06:42Z","snapshot_observed_at":"2026-08-15T08:13:22.977904Z","submitted_at":"2025-01-28T05:40:20Z","title":"Separate Motion from Appearance: Customizing Motion via Customizing Text-to-Video Diffusion Models","version":2},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-08-10T11:17:24.820268Z"},"links":{"cited_paper":"/paper/2304.02777","citing_paper":"/paper/2501.16714"},"observation_digest":"sha256:2b2a8fbe5d8eba87a74d6684a6a969076851388988f5b1d33b0eaed2f621ec62","observation_id":"41f599ec-a67f-4ea5-b07f-c202c896b9d1","resolution":{"observed_at":"2026-08-10T11:17:25.055305Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T11:17:25.266002Z","title":null,"venue":null,"work_id":"e8ece462-83d0-4fff-bae3-9119aa4fe0a4","year":2024},"citing_paper":{"arxiv_id":"2501.16714","last_updated":"2025-09-07T04:06:42Z","snapshot_observed_at":"2026-08-15T08:13:22.977904Z","submitted_at":"2025-01-28T05:40:20Z","title":"Separate Motion from Appearance: Customizing Motion via Customizing Text-to-Video Diffusion Models","version":2},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-08-10T11:17:24.824388Z"},"links":{"citing_paper":"/paper/2501.16714"},"observation_digest":"sha256:b1bd5a4d79fd1bc9e56c1a798a6830d09519b4fbd7ec902c130e08a0c2389359","observation_id":"38f3c9ed-7dd0-4c0d-b679-21a460b60043","resolution":{"observed_at":"2026-08-10T11:17:25.269787Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2209.14792","last_updated":"2022-09-29T13:59:46Z","snapshot_observed_at":"2026-07-06T13:57:47.051387Z","submitted_at":"2022-09-29T13:59:46Z","title":"Make-A-Video: Text-to-Video Generation without Text-Video Data","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2209.14792","snapshot_observed_at":"2026-08-10T11:17:24.828362Z","title":null,"venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2501.16714","last_updated":"2025-09-07T04:06:42Z","snapshot_observed_at":"2026-08-15T08:13:22.977904Z","submitted_at":"2025-01-28T05:40:20Z","title":"Separate Motion from Appearance: Customizing Motion via Customizing Text-to-Video Diffusion Models","version":2},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-08-10T11:17:24.828362Z"},"links":{"cited_paper":"/paper/2209.14792","citing_paper":"/paper/2501.16714"},"observation_digest":"sha256:146fa9fd47abba9cd8334253977e7eb0eac0e369189065e01068c9be45cdae87","observation_id":"c12dba9d-7315-4e93-a35b-123df795f689","resolution":{"observed_at":"2026-08-10T11:17:24.828362Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T11:17:25.255001Z","title":null,"venue":null,"work_id":"d601d985-24a9-4e27-9209-7b0042e4400d","year":2015},"citing_paper":{"arxiv_id":"2501.16714","last_updated":"2025-09-07T04:06:42Z","snapshot_observed_at":"2026-08-15T08:13:22.977904Z","submitted_at":"2025-01-28T05:40:20Z","title":"Separate Motion from Appearance: Customizing Motion via Customizing Text-to-Video Diffusion Models","version":2},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-08-10T11:17:24.832598Z"},"links":{"citing_paper":"/paper/2501.16714"},"observation_digest":"sha256:d389c7b5294daea35caa815f396f93882028103e47af5bd60b3eace42bd00818","observation_id":"8dc7b40b-655c-4f67-aa10-21d93b08478d","resolution":{"observed_at":"2026-08-10T11:17:25.259129Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T11:17:24.836297Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2501.16714","last_updated":"2025-09-07T04:06:42Z","snapshot_observed_at":"2026-08-15T08:13:22.977904Z","submitted_at":"2025-01-28T05:40:20Z","title":"Separate Motion from Appearance: Customizing Motion via Customizing Text-to-Video Diffusion Models","version":2},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-08-10T11:17:24.836297Z"},"links":{"citing_paper":"/paper/2501.16714"},"observation_digest":"sha256:e9171b07ae9cd00c578af4abb9e977c0d431715df4fea79b8611b8715377a5c8","observation_id":"7d5894b2-323f-4405-b314-fc4b857b2fdf","resolution":{"observed_at":"2026-08-10T11:17:24.836297Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2104.15069","last_updated":"2021-04-30T15:38:41Z","snapshot_observed_at":"2026-08-16T18:27:50.672545Z","submitted_at":"2021-04-30T15:38:41Z","title":"A Good Image Generator Is What You Need for High-Resolution Video Synthesis","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2104.15069","snapshot_observed_at":"2026-08-10T11:17:24.839983Z","title":"Metaxas, and Sergey Tulyakov","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2501.16714","last_updated":"2025-09-07T04:06:42Z","snapshot_observed_at":"2026-08-15T08:13:22.977904Z","submitted_at":"2025-01-28T05:40:20Z","title":"Separate Motion from Appearance: Customizing Motion via Customizing Text-to-Video Diffusion Models","version":2},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-08-10T11:17:24.839983Z"},"links":{"cited_paper":"/paper/2104.15069","citing_paper":"/paper/2501.16714"},"observation_digest":"sha256:d6a03a03bd09fda359bf81796acefbef6839cd5acd4dc992684cff347e021e5a","observation_id":"ae3acb05-92de-4a58-b489-53a06c048092","resolution":{"observed_at":"2026-08-10T11:17:24.839983Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T11:17:24.843887Z","title":null,"venue":null,"work_id":null,"year":2016},"citing_paper":{"arxiv_id":"2501.16714","last_updated":"2025-09-07T04:06:42Z","snapshot_observed_at":"2026-08-15T08:13:22.977904Z","submitted_at":"2025-01-28T05:40:20Z","title":"Separate Motion from Appearance: Customizing Motion via Customizing Text-to-Video Diffusion Models","version":2},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-08-10T11:17:24.843887Z"},"links":{"citing_paper":"/paper/2501.16714"},"observation_digest":"sha256:d96a952040aa7b19fd4e0cfbbbb9a12c3d0653647be2024c04f9be79bc47fc79","observation_id":"a91253d5-e832-458b-8a61-6f89d920ac4c","resolution":{"observed_at":"2026-08-10T11:17:24.843887Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2308.06571","last_updated":"2023-08-12T13:53:10Z","snapshot_observed_at":"2026-08-14T13:59:50.878772Z","submitted_at":"2023-08-12T13:53:10Z","title":"ModelScope Text-to-Video Technical Report","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2308.06571","snapshot_observed_at":"2026-08-10T11:17:24.847643Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2501.16714","last_updated":"2025-09-07T04:06:42Z","snapshot_observed_at":"2026-08-15T08:13:22.977904Z","submitted_at":"2025-01-28T05:40:20Z","title":"Separate Motion from Appearance: Customizing Motion via Customizing Text-to-Video Diffusion Models","version":2},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-08-10T11:17:24.847643Z"},"links":{"cited_paper":"/paper/2308.06571","citing_paper":"/paper/2501.16714"},"observation_digest":"sha256:cc6132258770412f9e0059bf1267798d691bcb89862ec08c33f1e54f8db19baf","observation_id":"5fb778f4-fb5c-41b4-b875-20c4f455237c","resolution":{"observed_at":"2026-08-10T11:17:24.847643Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T11:17:25.229815Z","title":null,"venue":null,"work_id":"14f538d9-6f81-4a2b-8fe5-bdd94409d053","year":2024},"citing_paper":{"arxiv_id":"2501.16714","last_updated":"2025-09-07T04:06:42Z","snapshot_observed_at":"2026-08-15T08:13:22.977904Z","submitted_at":"2025-01-28T05:40:20Z","title":"Separate Motion from Appearance: Customizing Motion via Customizing Text-to-Video Diffusion Models","version":2},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-08-10T11:17:24.851441Z"},"links":{"citing_paper":"/paper/2501.16714"},"observation_digest":"sha256:ca44dfafb35cedc416b7cde98d38335c6097b92a6a654a3f74aeb41fb94b9b9c","observation_id":"7a5a5e44-345b-4c7d-ba34-13234c58a52f","resolution":{"observed_at":"2026-08-10T11:17:25.233812Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2307.06942","last_updated":"2024-01-04T05:00:34Z","snapshot_observed_at":"2026-07-06T15:53:46.393481Z","submitted_at":"2023-07-13T17:58:32Z","title":"InternVid: A Large-scale Video-Text Dataset for Multimodal Understanding and Generation","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2307.06942","snapshot_observed_at":"2026-08-10T11:17:24.856008Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2501.16714","last_updated":"2025-09-07T04:06:42Z","snapshot_observed_at":"2026-08-15T08:13:22.977904Z","submitted_at":"2025-01-28T05:40:20Z","title":"Separate Motion from Appearance: Customizing Motion via Customizing Text-to-Video Diffusion Models","version":2},"reference_index":36,"source":"pdf_text","source_observed_at":"2026-08-10T11:17:24.856008Z"},"links":{"cited_paper":"/paper/2307.06942","citing_paper":"/paper/2501.16714"},"observation_digest":"sha256:7b1947c6b3caa0c0632f5b9435c70df8aa78e2a97756b15a1e0002ff11f7564f","observation_id":"4b653dc5-c7c2-4fc4-b10e-e1a3f159239a","resolution":{"observed_at":"2026-08-10T11:17:24.856008Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T11:17:24.860443Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2501.16714","last_updated":"2025-09-07T04:06:42Z","snapshot_observed_at":"2026-08-15T08:13:22.977904Z","submitted_at":"2025-01-28T05:40:20Z","title":"Separate Motion from Appearance: Customizing Motion via Customizing Text-to-Video Diffusion Models","version":2},"reference_index":37,"source":"pdf_text","source_observed_at":"2026-08-10T11:17:24.860443Z"},"links":{"citing_paper":"/paper/2501.16714"},"observation_digest":"sha256:fe3c7b011afd62e478e063608f7e993f857c6c145949dfe6c59ca497ccf80d48","observation_id":"0f555894-55a0-40fc-a59f-49b23db7f74f","resolution":{"observed_at":"2026-08-10T11:17:24.860443Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T11:17:24.864384Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2501.16714","last_updated":"2025-09-07T04:06:42Z","snapshot_observed_at":"2026-08-15T08:13:22.977904Z","submitted_at":"2025-01-28T05:40:20Z","title":"Separate Motion from Appearance: Customizing Motion via Customizing Text-to-Video Diffusion Models","version":2},"reference_index":38,"source":"pdf_text","source_observed_at":"2026-08-10T11:17:24.864384Z"},"links":{"citing_paper":"/paper/2501.16714"},"observation_digest":"sha256:472bc74c645dfecdf9e1f367910b8a339ac9fd11beb3275194c28f90bdb62c11","observation_id":"6469d19e-a933-471e-8e74-db46f226ec1a","resolution":{"observed_at":"2026-08-10T11:17:24.864384Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2310.16003","last_updated":"2023-10-24T16:56:58Z","snapshot_observed_at":"2026-08-16T14:49:15.874057Z","submitted_at":"2023-10-24T16:56:58Z","title":"CVPR 2023 Text Guided Video Editing Competition","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2310.16003","snapshot_observed_at":"2026-08-10T11:17:24.868298Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2501.16714","last_updated":"2025-09-07T04:06:42Z","snapshot_observed_at":"2026-08-15T08:13:22.977904Z","submitted_at":"2025-01-28T05:40:20Z","title":"Separate Motion from Appearance: Customizing Motion via Customizing Text-to-Video Diffusion Models","version":2},"reference_index":39,"source":"pdf_text","source_observed_at":"2026-08-10T11:17:24.868298Z"},"links":{"cited_paper":"/paper/2310.16003","citing_paper":"/paper/2501.16714"},"observation_digest":"sha256:76b241a18a52f02619f948564c05acb2a6f0fc79d9cb6905956048e9961777f5","observation_id":"ccd28ec0-cff8-4385-b012-030e68eef906","resolution":{"observed_at":"2026-08-10T11:17:24.868298Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T11:17:25.203151Z","title":null,"venue":null,"work_id":"4c3235de-1452-42ff-8f57-0ea807279c04","year":2024},"citing_paper":{"arxiv_id":"2501.16714","last_updated":"2025-09-07T04:06:42Z","snapshot_observed_at":"2026-08-15T08:13:22.977904Z","submitted_at":"2025-01-28T05:40:20Z","title":"Separate Motion from Appearance: Customizing Motion via Customizing Text-to-Video Diffusion Models","version":2},"reference_index":40,"source":"pdf_text","source_observed_at":"2026-08-10T11:17:24.872630Z"},"links":{"citing_paper":"/paper/2501.16714"},"observation_digest":"sha256:05ba14ae702f6d51070f75fa3c26849fd2e8e0ac11b638efa13a8b4f1ae4a2ac","observation_id":"59512b05-60ee-49a2-824d-0240f012b100","resolution":{"observed_at":"2026-08-10T11:17:25.207227Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T11:17:25.191700Z","title":null,"venue":null,"work_id":"1ef96c91-f1c6-4a19-8bfb-0379bc6f3132","year":2023},"citing_paper":{"arxiv_id":"2501.16714","last_updated":"2025-09-07T04:06:42Z","snapshot_observed_at":"2026-08-15T08:13:22.977904Z","submitted_at":"2025-01-28T05:40:20Z","title":"Separate Motion from Appearance: Customizing Motion via Customizing Text-to-Video Diffusion Models","version":2},"reference_index":41,"source":"pdf_text","source_observed_at":"2026-08-10T11:17:24.876562Z"},"links":{"citing_paper":"/paper/2501.16714"},"observation_digest":"sha256:393b99f9c8165c6fc94fa3e4a80b9f57b42e68249b0d85a2df80ed28ef6c318c","observation_id":"3007c7c4-68ef-49c6-b1af-1711ce76c993","resolution":{"observed_at":"2026-08-10T11:17:25.195218Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2104.10157","last_updated":"2021-09-14T21:20:06Z","snapshot_observed_at":"2026-08-17T06:54:13.493934Z","submitted_at":"2021-04-20T17:58:03Z","title":"VideoGPT: Video Generation using VQ-VAE and Transformers","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2104.10157","snapshot_observed_at":"2026-08-10T11:17:24.881055Z","title":null,"venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2501.16714","last_updated":"2025-09-07T04:06:42Z","snapshot_observed_at":"2026-08-15T08:13:22.977904Z","submitted_at":"2025-01-28T05:40:20Z","title":"Separate Motion from Appearance: Customizing Motion via Customizing Text-to-Video Diffusion Models","version":2},"reference_index":42,"source":"pdf_text","source_observed_at":"2026-08-10T11:17:24.881055Z"},"links":{"cited_paper":"/paper/2104.10157","citing_paper":"/paper/2501.16714"},"observation_digest":"sha256:5b1421d62ab55431e6152060a6c951bbce1f8505ff048ba740b95c0e75013e67","observation_id":"32063917-0a22-4d9a-9290-6bef0109ab90","resolution":{"observed_at":"2026-08-10T11:17:24.881055Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T11:17:24.885047Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2501.16714","last_updated":"2025-09-07T04:06:42Z","snapshot_observed_at":"2026-08-15T08:13:22.977904Z","submitted_at":"2025-01-28T05:40:20Z","title":"Separate Motion from Appearance: Customizing Motion via Customizing Text-to-Video Diffusion Models","version":2},"reference_index":43,"source":"pdf_text","source_observed_at":"2026-08-10T11:17:24.885047Z"},"links":{"citing_paper":"/paper/2501.16714"},"observation_digest":"sha256:8037fd366bdbab56ca8fad7170d952be8fdc3686581430dc15ab697adaaee1c9","observation_id":"17d21a95-98f7-46bb-b3a6-06823772285a","resolution":{"observed_at":"2026-08-10T11:17:24.885047Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2309.15818","last_updated":"2025-05-30T03:55:20Z","snapshot_observed_at":"2026-08-16T14:57:07.106568Z","submitted_at":"2023-09-27T17:44:18Z","title":"Show-1: Marrying Pixel and Latent Diffusion Models for Text-to-Video Generation","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2309.15818","snapshot_observed_at":"2026-08-10T11:17:24.888752Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2501.16714","last_updated":"2025-09-07T04:06:42Z","snapshot_observed_at":"2026-08-15T08:13:22.977904Z","submitted_at":"2025-01-28T05:40:20Z","title":"Separate Motion from Appearance: Customizing Motion via Customizing Text-to-Video Diffusion Models","version":2},"reference_index":44,"source":"pdf_text","source_observed_at":"2026-08-10T11:17:24.888752Z"},"links":{"cited_paper":"/paper/2309.15818","citing_paper":"/paper/2501.16714"},"observation_digest":"sha256:c0b0cfbd95f8cfcf284c3dc6fd6df22dfb3e286c7b18ebf857e347d974c39069","observation_id":"501f2b6f-5abd-4022-a7bc-d9cacc3cced1","resolution":{"observed_at":"2026-08-10T11:17:24.888752Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2311.04145","last_updated":"2023-11-07T17:16:06Z","snapshot_observed_at":"2026-08-02T12:25:34.488259Z","submitted_at":"2023-11-07T17:16:06Z","title":"I2VGen-XL: High-Quality Image-to-Video Synthesis via Cascaded Diffusion Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2311.04145","snapshot_observed_at":"2026-08-10T11:17:24.892542Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2501.16714","last_updated":"2025-09-07T04:06:42Z","snapshot_observed_at":"2026-08-15T08:13:22.977904Z","submitted_at":"2025-01-28T05:40:20Z","title":"Separate Motion from Appearance: Customizing Motion via Customizing Text-to-Video Diffusion Models","version":2},"reference_index":45,"source":"pdf_text","source_observed_at":"2026-08-10T11:17:24.892542Z"},"links":{"cited_paper":"/paper/2311.04145","citing_paper":"/paper/2501.16714"},"observation_digest":"sha256:3a26a0dd452998f05e5a10f9dd369e4d7b6d3791b1af06b480a4a7ff839dd4cd","observation_id":"cecb1ca9-6dcd-42c1-82b5-466deb25c6c1","resolution":{"observed_at":"2026-08-10T11:17:24.892542Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2305.13077","last_updated":"2023-05-22T14:48:53Z","snapshot_observed_at":"2026-08-16T15:31:04.577141Z","submitted_at":"2023-05-22T14:48:53Z","title":"ControlVideo: Training-free Controllable Text-to-Video Generation","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2305.13077","snapshot_observed_at":"2026-08-10T11:17:24.896071Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2501.16714","last_updated":"2025-09-07T04:06:42Z","snapshot_observed_at":"2026-08-15T08:13:22.977904Z","submitted_at":"2025-01-28T05:40:20Z","title":"Separate Motion from Appearance: Customizing Motion via Customizing Text-to-Video Diffusion Models","version":2},"reference_index":46,"source":"pdf_text","source_observed_at":"2026-08-10T11:17:24.896071Z"},"links":{"cited_paper":"/paper/2305.13077","citing_paper":"/paper/2501.16714"},"observation_digest":"sha256:f8c46853128fb7f713fcdd72c85e4fe68cfa9dfe35b28d2b25e3907aefd4b9d9","observation_id":"162719ec-b930-4feb-9a5c-4f9162495ce4","resolution":{"observed_at":"2026-08-10T11:17:24.896071Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2310.08465","last_updated":"2023-10-12T16:26:18Z","snapshot_observed_at":"2026-08-16T14:52:38.251606Z","submitted_at":"2023-10-12T16:26:18Z","title":"MotionDirector: Motion Customization of Text-to-Video Diffusion Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2310.08465","snapshot_observed_at":"2026-08-10T11:17:24.899736Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2501.16714","last_updated":"2025-09-07T04:06:42Z","snapshot_observed_at":"2026-08-15T08:13:22.977904Z","submitted_at":"2025-01-28T05:40:20Z","title":"Separate Motion from Appearance: Customizing Motion via Customizing Text-to-Video Diffusion Models","version":2},"reference_index":47,"source":"pdf_text","source_observed_at":"2026-08-10T11:17:24.899736Z"},"links":{"cited_paper":"/paper/2310.08465","citing_paper":"/paper/2501.16714"},"observation_digest":"sha256:a22de710d6dab10b0aff352c55bc0eb518e10abbad6310c54bca31e8183b0967","observation_id":"8cf55463-ba75-4397-8a5d-1ad2035962a9","resolution":{"observed_at":"2026-08-10T11:17:24.899736Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2211.11018","last_updated":"2023-05-11T11:23:03Z","snapshot_observed_at":"2026-08-16T05:49:16.026825Z","submitted_at":"2022-11-20T16:40:31Z","title":"MagicVideo: Efficient Video Generation With Latent Diffusion Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2211.11018","snapshot_observed_at":"2026-08-10T11:17:24.903509Z","title":null,"venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2501.16714","last_updated":"2025-09-07T04:06:42Z","snapshot_observed_at":"2026-08-15T08:13:22.977904Z","submitted_at":"2025-01-28T05:40:20Z","title":"Separate Motion from Appearance: Customizing Motion via Customizing Text-to-Video Diffusion Models","version":2},"reference_index":48,"source":"pdf_text","source_observed_at":"2026-08-10T11:17:24.903509Z"},"links":{"cited_paper":"/paper/2211.11018","citing_paper":"/paper/2501.16714"},"observation_digest":"sha256:4c153371306201d2a584cd07b0f0acd010404e30ff7e8ca6b57714f405270d81","observation_id":"878c0bc6-71f8-4a08-96bc-4a05028269bc","resolution":{"observed_at":"2026-08-10T11:17:24.903509Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T11:17:25.339799Z","title":null,"venue":null,"work_id":"d493d362-faa3-492f-8e80-f885e98fd510","year":2024},"citing_paper":{"arxiv_id":"2501.16714","last_updated":"2025-09-07T04:06:42Z","snapshot_observed_at":"2026-08-15T08:13:22.977904Z","submitted_at":"2025-01-28T05:40:20Z","title":"Separate Motion from Appearance: Customizing Motion via Customizing Text-to-Video Diffusion Models","version":2},"reference_index":2024,"source":"pdf_text","source_observed_at":"2026-08-10T11:17:24.779416Z"},"links":{"citing_paper":"/paper/2501.16714"},"observation_digest":"sha256:6e5e679e539786a2a26715af840225359fa35a226f1b8a1ce8b4fc0c20dfb7c5","observation_id":"01051b4d-0ff1-48c4-a1f1-0e70cfbd5087","resolution":{"observed_at":"2026-08-10T11:17:25.343350Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}}],"paper":{"arxiv_id":"2501.16714","last_updated":"2025-09-07T04:06:42Z","latest_version":2,"primary_category":"cs.CV","snapshot_observed_at":"2026-08-15T08:13:22.977904Z","submitted_at":"2025-01-28T05:40:20Z","title":"Separate Motion from Appearance: Customizing Motion via Customizing Text-to-Video Diffusion Models"},"reference_resolution":{"displayed":49,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":46,"verified_exact":3,"verified_fuzzy":0},"total_outbound_references":49},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"thesis":"As of 17 August 2026, this Paper Citation Record lists 49 of 49 outbound references and 1 inbound Pith citation observation for arXiv:2501.16714."}