{"as_of":"2026-08-12T10:43:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:2f974f709cc5f86c858a9b68e42a12c9ef4efad328165f6b3ecde4c25e3ac9f0","coverage":[{"denominator":58,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":58,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-05T20:46:54.281971Z","state":"measured"},{"denominator":61,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":61,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-12T06:34:41.77262+00:00","state":"measured"},{"denominator":3,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":3,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-03T15:28:58.839701Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"arxiv_reference","source_observed_at":"2026-05-21T19:04:19.314384Z","state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2508.09959","last_updated":"2025-08-13T17:22:05Z","snapshot_observed_at":"2026-08-07T22:09:59.442556Z","submitted_at":"2025-08-13T17:22:05Z","title":"LIA-X: Interpretable Latent Portrait Animator","version":1},"cited_work":{"arxiv_id":"2508.09959","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2508.09959","snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"A recipe for scaling up text-to-video generation with text-free videos","venue":null,"work_id":"2335c51e-4704-4efe-a5d0-77a99e5a27c4","year":null},"citing_paper":{"arxiv_id":"2511.04520","last_updated":"2026-05-20T15:14:20Z","snapshot_observed_at":"2026-07-31T21:47:41.347121Z","submitted_at":"2025-11-06T16:34:10Z","title":"THEval. Evaluation Framework for Talking Head Video Generation","version":4},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-05-21T19:00:48.999456Z"},"links":{"cited_paper":"/paper/2508.09959","citing_paper":"/paper/2511.04520"},"observation_digest":"sha256:001de77d0a83fa772cedc6fdb8bf357a0e4102496f372bbd26e5868fcb72e196","observation_id":"466da993-75e9-457f-8c91-3a58a96200e3","resolution":{"observed_at":"2026-05-21T19:04:19.318078Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2508.09959","last_updated":"2025-08-13T17:22:05Z","snapshot_observed_at":"2026-08-07T22:09:59.442556Z","submitted_at":"2025-08-13T17:22:05Z","title":"LIA-X: Interpretable Latent Portrait Animator","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2508.09959","snapshot_observed_at":"2026-08-03T15:28:58.839701Z","title":"Lia-x: Interpretable latent portrait animator.arXiv preprint arXiv:2508.09959, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2512.16893","last_updated":"2026-06-26T16:02:20Z","snapshot_observed_at":"2026-08-09T14:59:21.358895Z","submitted_at":"2025-12-18T18:53:28Z","title":"Instant Expressive Gaussian Head Avatars at Over 100 FPS","version":2},"reference_index":87,"source":"pdf_text","source_observed_at":"2026-08-03T15:28:58.839701Z"},"links":{"cited_paper":"/paper/2508.09959","citing_paper":"/paper/2512.16893"},"observation_digest":"sha256:da69c2423a2ea453a8e9c8b5d086a51fe8464714f31565591c7aebfbc13c2085","observation_id":"d10608a8-1cda-4c67-832c-b3d122e52465","resolution":{"observed_at":"2026-08-03T15:28:58.839701Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2508.09959","last_updated":"2025-08-13T17:22:05Z","snapshot_observed_at":"2026-08-07T22:09:59.442556Z","submitted_at":"2025-08-13T17:22:05Z","title":"LIA-X: Interpretable Latent Portrait Animator","version":1},"cited_work":{"arxiv_id":"2508.09959","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2508.09959","snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"A recipe for scaling up text-to-video generation with text-free videos","venue":null,"work_id":"2335c51e-4704-4efe-a5d0-77a99e5a27c4","year":null},"citing_paper":{"arxiv_id":"2604.23586","last_updated":"2026-08-04T09:15:37Z","snapshot_observed_at":"2026-08-07T23:09:24.588848Z","submitted_at":"2026-04-26T07:48:47Z","title":"Talker-T2AV: Joint Talking Audio-Video Generation with Autoregressive Diffusion Modeling","version":1},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-05-08T06:44:36.000353Z"},"links":{"cited_paper":"/paper/2508.09959","citing_paper":"/paper/2604.23586"},"observation_digest":"sha256:37ec5ca6f2017936214aec94a095ba3eac47a045f7f343855fe9d189b3a4b849","observation_id":"c2559550-d0bf-4ef6-b1b6-8f68d8ea845a","resolution":{"observed_at":"2026-05-11T21:06:14.366989Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}}],"links":{"evidence":"/evidence","html":"/paper/2508.09959/citation-record","integrity":"/paper/2508.09959/integrity","json":"/paper/2508.09959/citation-record.json","paper":"/paper/2508.09959"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T20:46:54.791458Z","title":"Align your latents: High-resolution video synthesis with la- tent diffusion models","venue":null,"work_id":"f5fb8da7-dd9b-409e-9d54-998214f3c0b3","year":2023},"citing_paper":{"arxiv_id":"2508.09959","last_updated":"2025-08-13T17:22:05Z","snapshot_observed_at":"2026-08-07T22:09:59.442556Z","submitted_at":"2025-08-13T17:22:05Z","title":"LIA-X: Interpretable Latent Portrait Animator","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-05T20:46:54.130061Z"},"links":{"citing_paper":"/paper/2508.09959"},"observation_digest":"sha256:e76d078ce345da515b5675d22883c7d638010ecca24dfcc89c392f8ed43fd983","observation_id":"6a40b247-6d55-491d-a39c-c08b5c4f7768","resolution":{"observed_at":"2026-08-05T20:46:54.794776Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T20:46:54.782882Z","title":"Generating long videos of dynamic scenes","venue":null,"work_id":"02a49b41-b5a9-402b-8a51-d71dcb78ed1e","year":2022},"citing_paper":{"arxiv_id":"2508.09959","last_updated":"2025-08-13T17:22:05Z","snapshot_observed_at":"2026-08-07T22:09:59.442556Z","submitted_at":"2025-08-13T17:22:05Z","title":"LIA-X: Interpretable Latent Portrait Animator","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-05T20:46:54.133241Z"},"links":{"citing_paper":"/paper/2508.09959"},"observation_digest":"sha256:83984450bfb83ef4a1f72c0bea12ada76c015a551b527d541da99079b15e05e9","observation_id":"ecc37aeb-4300-430d-b414-ac49f0d5f108","resolution":{"observed_at":"2026-08-05T20:46:54.785695Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T20:46:54.136241Z","title":"Video generation models as world simulators","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2508.09959","last_updated":"2025-08-13T17:22:05Z","snapshot_observed_at":"2026-08-07T22:09:59.442556Z","submitted_at":"2025-08-13T17:22:05Z","title":"LIA-X: Interpretable Latent Portrait Animator","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-05T20:46:54.136241Z"},"links":{"citing_paper":"/paper/2508.09959"},"observation_digest":"sha256:d082c83645e2cd6578bff439acb71db206baa0c242fa66fb9848383833ce81c2","observation_id":"860bd75e-4cdf-4e3e-bd10-6d5ae8320eed","resolution":{"observed_at":"2026-08-05T20:46:54.136241Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T20:46:54.769279Z","title":"Everybody dance now","venue":null,"work_id":"c6a11be5-da4c-49c5-9062-41ec4c4fb72c","year":2019},"citing_paper":{"arxiv_id":"2508.09959","last_updated":"2025-08-13T17:22:05Z","snapshot_observed_at":"2026-08-07T22:09:59.442556Z","submitted_at":"2025-08-13T17:22:05Z","title":"LIA-X: Interpretable Latent Portrait Animator","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-05T20:46:54.139082Z"},"links":{"citing_paper":"/paper/2508.09959"},"observation_digest":"sha256:59daaa759cb43e958d9d2d1046609856e155750de74b7d97da3b8c189e3d746f","observation_id":"9b269fa2-15b1-49d5-90dc-1438496c8aa3","resolution":{"observed_at":"2026-08-05T20:46:54.772594Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2311.12052","last_updated":"2024-05-05T05:07:34Z","snapshot_observed_at":"2026-08-01T16:10:16.293275Z","submitted_at":"2023-11-18T10:22:44Z","title":"MagicPose: Realistic Human Poses and Facial Expressions Retargeting with Identity-aware Diffusion","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2311.12052","snapshot_observed_at":"2026-08-05T20:46:54.142060Z","title":"Magicdance: Realistic human dance video gen- eration with motions & facial expressions transfer","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2508.09959","last_updated":"2025-08-13T17:22:05Z","snapshot_observed_at":"2026-08-07T22:09:59.442556Z","submitted_at":"2025-08-13T17:22:05Z","title":"LIA-X: Interpretable Latent Portrait Animator","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-05T20:46:54.142060Z"},"links":{"cited_paper":"/paper/2311.12052","citing_paper":"/paper/2508.09959"},"observation_digest":"sha256:de9821d3d4fd9d9b31ca6d4863479c21750b067443458eb4b6af58d78c06736d","observation_id":"d2d56ade-c32f-4ec7-8ae8-f8ff51bfa50d","resolution":{"observed_at":"2026-08-05T20:46:54.142060Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T20:46:54.761691Z","title":"Joint generative and con- trastive learning for unsupervised person re-identification","venue":null,"work_id":"62286fae-32b0-4001-9794-2bc12f9b6d0d","year":2021},"citing_paper":{"arxiv_id":"2508.09959","last_updated":"2025-08-13T17:22:05Z","snapshot_observed_at":"2026-08-07T22:09:59.442556Z","submitted_at":"2025-08-13T17:22:05Z","title":"LIA-X: Interpretable Latent Portrait Animator","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-05T20:46:54.145189Z"},"links":{"citing_paper":"/paper/2508.09959"},"observation_digest":"sha256:4af93ff8e9daf2dbda223d675d270ee1ca90d71b143a6d4d0ae865287ef99815","observation_id":"753b57d6-524d-4aba-a944-7531b59ed9aa","resolution":{"observed_at":"2026-08-05T20:46:54.764319Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T20:46:54.753802Z","title":"Videocrafter2: Overcoming data limitations for high-quality video diffusion models","venue":null,"work_id":"43731b23-e348-4f79-aac3-eb6aad3779bf","year":2024},"citing_paper":{"arxiv_id":"2508.09959","last_updated":"2025-08-13T17:22:05Z","snapshot_observed_at":"2026-08-07T22:09:59.442556Z","submitted_at":"2025-08-13T17:22:05Z","title":"LIA-X: Interpretable Latent Portrait Animator","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-05T20:46:54.147928Z"},"links":{"citing_paper":"/paper/2508.09959"},"observation_digest":"sha256:78aad6d678a98068d4ac75fc5ccaaa30e4e90fac7c42645771a731dc7b0beadf","observation_id":"e4c97c71-e230-4cba-9492-c5a5c8630718","resolution":{"observed_at":"2026-08-05T20:46:54.756556Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T20:46:54.745757Z","title":"Seine: Short-to-long video diffusion model for generative transition and prediction","venue":null,"work_id":"6b27d48d-cda0-44b9-8c3d-1d5f3d8bd18c","year":2023},"citing_paper":{"arxiv_id":"2508.09959","last_updated":"2025-08-13T17:22:05Z","snapshot_observed_at":"2026-08-07T22:09:59.442556Z","submitted_at":"2025-08-13T17:22:05Z","title":"LIA-X: Interpretable Latent Portrait Animator","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-05T20:46:54.150695Z"},"links":{"citing_paper":"/paper/2508.09959"},"observation_digest":"sha256:35b9cad1f1501c5ae984c7754d5c815d966eda934b50f0c0f53267b3d324d76f","observation_id":"da4ccdd3-a9db-4904-9c9a-103363c16682","resolution":{"observed_at":"2026-08-05T20:46:54.748521Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1907.06571","last_updated":"2019-09-25T16:37:55Z","snapshot_observed_at":"2026-08-10T10:12:45.825450Z","submitted_at":"2019-07-15T16:27:04Z","title":"Adversarial Video Generation on Complex Datasets","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1907.06571","snapshot_observed_at":"2026-08-05T20:46:54.153220Z","title":"Adver- sarial video generation on complex datasets","venue":null,"work_id":null,"year":1907},"citing_paper":{"arxiv_id":"2508.09959","last_updated":"2025-08-13T17:22:05Z","snapshot_observed_at":"2026-08-07T22:09:59.442556Z","submitted_at":"2025-08-13T17:22:05Z","title":"LIA-X: Interpretable Latent Portrait Animator","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-05T20:46:54.153220Z"},"links":{"cited_paper":"/paper/1907.06571","citing_paper":"/paper/2508.09959"},"observation_digest":"sha256:0fe362e2f549a3c9a471538b55f712d9da4d6ffacb21357fd8d8ffbbff692f38","observation_id":"2bab6b86-4575-425b-b211-2878e63776d9","resolution":{"observed_at":"2026-08-05T20:46:54.153220Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T20:46:54.737055Z","title":"Generative adversarial nets","venue":null,"work_id":"acc2652c-a70c-426d-bd55-4d48e7f9238a","year":2014},"citing_paper":{"arxiv_id":"2508.09959","last_updated":"2025-08-13T17:22:05Z","snapshot_observed_at":"2026-08-07T22:09:59.442556Z","submitted_at":"2025-08-13T17:22:05Z","title":"LIA-X: Interpretable Latent Portrait Animator","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-05T20:46:54.156113Z"},"links":{"citing_paper":"/paper/2508.09959"},"observation_digest":"sha256:3e20aa84ab3a9344cbe82c806a0cdbe9708e53df89120c612b218db0acd0b4c1","observation_id":"82cff072-b54d-4e41-a35d-68a0afa609a8","resolution":{"observed_at":"2026-08-05T20:46:54.740117Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2407.03168","last_updated":"2025-02-28T14:39:17Z","snapshot_observed_at":"2026-08-08T10:55:01.205999Z","submitted_at":"2024-07-03T14:41:39Z","title":"LivePortrait: Efficient Portrait Animation with Stitching and Retargeting Control","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2407.03168","snapshot_observed_at":"2026-08-05T20:46:54.158624Z","title":"Livepor- trait: Efficient portrait animation with stitching and retarget- ing control","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2508.09959","last_updated":"2025-08-13T17:22:05Z","snapshot_observed_at":"2026-08-07T22:09:59.442556Z","submitted_at":"2025-08-13T17:22:05Z","title":"LIA-X: Interpretable Latent Portrait Animator","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-05T20:46:54.158624Z"},"links":{"cited_paper":"/paper/2407.03168","citing_paper":"/paper/2508.09959"},"observation_digest":"sha256:0f470c80ffc0a926bf8dea07e856ddf5105150754087d1b56639c6d4bad37942","observation_id":"2b083382-7765-43cc-8ed8-2139cf5d5285","resolution":{"observed_at":"2026-08-05T20:46:54.158624Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T20:46:54.728307Z","title":"Animatediff: Animate your personalized text-to- image diffusion models without specific tuning","venue":null,"work_id":"43ba0ebe-470c-4112-851d-1e019d86071e","year":2024},"citing_paper":{"arxiv_id":"2508.09959","last_updated":"2025-08-13T17:22:05Z","snapshot_observed_at":"2026-08-07T22:09:59.442556Z","submitted_at":"2025-08-13T17:22:05Z","title":"LIA-X: Interpretable Latent Portrait Animator","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-05T20:46:54.161496Z"},"links":{"citing_paper":"/paper/2508.09959"},"observation_digest":"sha256:5dc61f13f246f0a949bcddd5983ddb0d50a1be9a3238b16a8bf6de7fd938f60f","observation_id":"eb21ecd7-b84c-4206-9f22-3c603516758f","resolution":{"observed_at":"2026-08-05T20:46:54.731888Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T20:46:54.719496Z","title":"Denoising diffu- sion probabilistic models","venue":null,"work_id":"c48da578-b9ae-414f-b570-d381782c2884","year":2020},"citing_paper":{"arxiv_id":"2508.09959","last_updated":"2025-08-13T17:22:05Z","snapshot_observed_at":"2026-08-07T22:09:59.442556Z","submitted_at":"2025-08-13T17:22:05Z","title":"LIA-X: Interpretable Latent Portrait Animator","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-05T20:46:54.164595Z"},"links":{"citing_paper":"/paper/2508.09959"},"observation_digest":"sha256:15ef68d1159d135d393d9cd2542fb05552d2cfcbba9d4a56c11db0e71fa46567","observation_id":"ae2004a0-ca36-4eb1-affb-4720ba0a7512","resolution":{"observed_at":"2026-08-05T20:46:54.722724Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2210.02303","last_updated":"2022-10-05T14:41:38Z","snapshot_observed_at":"2026-07-06T13:59:57.800591Z","submitted_at":"2022-10-05T14:41:38Z","title":"Imagen Video: High Definition Video Generation with Diffusion Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2210.02303","snapshot_observed_at":"2026-08-05T20:46:54.167133Z","title":"Imagen video: High definition video generation with diffusion mod- els","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2508.09959","last_updated":"2025-08-13T17:22:05Z","snapshot_observed_at":"2026-08-07T22:09:59.442556Z","submitted_at":"2025-08-13T17:22:05Z","title":"LIA-X: Interpretable Latent Portrait Animator","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-05T20:46:54.167133Z"},"links":{"cited_paper":"/paper/2210.02303","citing_paper":"/paper/2508.09959"},"observation_digest":"sha256:692a3b82509f18e70779979841287ee811a1fc0077fa34e4d31ee65331651c51","observation_id":"da4ad382-b3b1-464a-9616-202720c2d411","resolution":{"observed_at":"2026-08-05T20:46:54.167133Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T20:46:54.710677Z","title":"Implicit identity representation conditioned memory compensation network for talking head video generation","venue":null,"work_id":"d17e3a91-56fb-4f8c-9465-fc4059de61ec","year":2023},"citing_paper":{"arxiv_id":"2508.09959","last_updated":"2025-08-13T17:22:05Z","snapshot_observed_at":"2026-08-07T22:09:59.442556Z","submitted_at":"2025-08-13T17:22:05Z","title":"LIA-X: Interpretable Latent Portrait Animator","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-05T20:46:54.170010Z"},"links":{"citing_paper":"/paper/2508.09959"},"observation_digest":"sha256:fa0ba9c83ce7ff7ab6b13e6a85c2422b5bd3464e61fde7bb41c1c20f37880f92","observation_id":"8240a8df-b30b-4d85-be42-cc9d7b63f9dc","resolution":{"observed_at":"2026-08-05T20:46:54.713712Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T20:46:54.701576Z","title":"Depth-aware generative adversarial network for talking head video generation","venue":null,"work_id":"82b6316e-1ced-4555-83b1-0e3d2acd2a1a","year":2022},"citing_paper":{"arxiv_id":"2508.09959","last_updated":"2025-08-13T17:22:05Z","snapshot_observed_at":"2026-08-07T22:09:59.442556Z","submitted_at":"2025-08-13T17:22:05Z","title":"LIA-X: Interpretable Latent Portrait Animator","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-05T20:46:54.172441Z"},"links":{"citing_paper":"/paper/2508.09959"},"observation_digest":"sha256:98886f185a929eaac7404a83a066b20d421a96d9e2cb0532ba23f75cdd0b0523","observation_id":"685938ef-161b-4bbc-9e9f-d65265fcfa2f","resolution":{"observed_at":"2026-08-05T20:46:54.705130Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T20:46:54.693049Z","title":"Flow-grounded spatial-temporal video prediction from still images","venue":null,"work_id":"599cc249-5f98-46f5-998a-58402bbb9cca","year":2018},"citing_paper":{"arxiv_id":"2508.09959","last_updated":"2025-08-13T17:22:05Z","snapshot_observed_at":"2026-08-07T22:09:59.442556Z","submitted_at":"2025-08-13T17:22:05Z","title":"LIA-X: Interpretable Latent Portrait Animator","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-05T20:46:54.174812Z"},"links":{"citing_paper":"/paper/2508.09959"},"observation_digest":"sha256:dc4b375cfeb52bc81a4532d8d2f64ce75b4447e7fee10e7053ba623186804ddd","observation_id":"3b076f1c-fb1c-4b15-a541-1e0810a70bb3","resolution":{"observed_at":"2026-08-05T20:46:54.695962Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T20:46:54.684678Z","title":"Blendgan: Implicitly gan blending for arbitrary stylized face generation","venue":null,"work_id":"77a3a2c5-30e8-4a2f-a78f-9db6f61d890a","year":2021},"citing_paper":{"arxiv_id":"2508.09959","last_updated":"2025-08-13T17:22:05Z","snapshot_observed_at":"2026-08-07T22:09:59.442556Z","submitted_at":"2025-08-13T17:22:05Z","title":"LIA-X: Interpretable Latent Portrait Animator","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-05T20:46:54.177376Z"},"links":{"citing_paper":"/paper/2508.09959"},"observation_digest":"sha256:35aa40fea52609ba84dcce644449ce2f64ab8d95b2a0903eeb16e6b9efe6c862","observation_id":"62bcd284-f542-4cd0-b3cb-70b22484b20c","resolution":{"observed_at":"2026-08-05T20:46:54.687569Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T20:46:54.675710Z","title":"Liquid warping gan: A unified framework for human motion imitation, appearance transfer and novel view synthesis","venue":null,"work_id":"2eea26aa-5bda-48c6-97a8-06dffbb7a594","year":2019},"citing_paper":{"arxiv_id":"2508.09959","last_updated":"2025-08-13T17:22:05Z","snapshot_observed_at":"2026-08-07T22:09:59.442556Z","submitted_at":"2025-08-13T17:22:05Z","title":"LIA-X: Interpretable Latent Portrait Animator","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-05T20:46:54.180046Z"},"links":{"citing_paper":"/paper/2508.09959"},"observation_digest":"sha256:b190a180a2bc579806e0a13c127aca528c5ede162527ddbb3dadca9d6f8350e2","observation_id":"b1dfa6fc-d6c4-4ab9-ba40-c98bc9f972c4","resolution":{"observed_at":"2026-08-05T20:46:54.679039Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T20:46:54.182415Z","title":"Latte: La- tent diffusion transformer for video generation.Transactions on Machine Learning Research, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2508.09959","last_updated":"2025-08-13T17:22:05Z","snapshot_observed_at":"2026-08-07T22:09:59.442556Z","submitted_at":"2025-08-13T17:22:05Z","title":"LIA-X: Interpretable Latent Portrait Animator","version":1},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-05T20:46:54.182415Z"},"links":{"citing_paper":"/paper/2508.09959"},"observation_digest":"sha256:f0974d54f02dc1497bb308208c428a9a9c562db2343a8e56e7f4384a70728110","observation_id":"b54bb9fa-89fc-48e5-8a9f-04a947170742","resolution":{"observed_at":"2026-08-05T20:46:54.182415Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2406.01900","last_updated":"2024-06-07T02:57:36Z","snapshot_observed_at":"2026-08-11T18:28:21.774537Z","submitted_at":"2024-06-04T02:05:57Z","title":"Follow-Your-Emoji: Fine-Controllable and Expressive Freestyle Portrait Animation","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2406.01900","snapshot_observed_at":"2026-08-05T20:46:54.184990Z","title":"Follow-your-emoji: Fine-controllable and expressive freestyle portrait animation","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2508.09959","last_updated":"2025-08-13T17:22:05Z","snapshot_observed_at":"2026-08-07T22:09:59.442556Z","submitted_at":"2025-08-13T17:22:05Z","title":"LIA-X: Interpretable Latent Portrait Animator","version":1},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-05T20:46:54.184990Z"},"links":{"cited_paper":"/paper/2406.01900","citing_paper":"/paper/2508.09959"},"observation_digest":"sha256:412e321cf693acfdb2c79686c6568bfbe90841a629092ad98fd7d02b9f090f77","observation_id":"22e27576-9d32-45bc-bf3c-00694160a4db","resolution":{"observed_at":"2026-08-05T20:46:54.184990Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T20:46:54.662483Z","title":"Snap video: Scaled spatiotemporal transformers for text-to-video synthesis","venue":null,"work_id":"48f113ec-c200-4dd7-b6de-1b2e2d503052","year":2024},"citing_paper":{"arxiv_id":"2508.09959","last_updated":"2025-08-13T17:22:05Z","snapshot_observed_at":"2026-08-07T22:09:59.442556Z","submitted_at":"2025-08-13T17:22:05Z","title":"LIA-X: Interpretable Latent Portrait Animator","version":1},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-05T20:46:54.187787Z"},"links":{"citing_paper":"/paper/2508.09959"},"observation_digest":"sha256:19450bc91e34dde5781023bd874fda0cc35f08a49cd37898120f6c03db4c108e","observation_id":"a9e1aadf-2798-49fd-bec4-0f063157af43","resolution":{"observed_at":"2026-08-05T20:46:54.665313Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T20:46:54.654317Z","title":"Hierarchical video generation from or- thogonal information: Optical flow and texture","venue":null,"work_id":"0c45787f-f814-41e1-97d1-133ce759080d","year":null},"citing_paper":{"arxiv_id":"2508.09959","last_updated":"2025-08-13T17:22:05Z","snapshot_observed_at":"2026-08-07T22:09:59.442556Z","submitted_at":"2025-08-13T17:22:05Z","title":"LIA-X: Interpretable Latent Portrait Animator","version":1},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-05T20:46:54.190286Z"},"links":{"citing_paper":"/paper/2508.09959"},"observation_digest":"sha256:1cf3044e3851e6296790c4acdb30333320f8ba4216aa9a78367192e7e52406ee","observation_id":"0f1ca2b5-66a2-4dd0-a93d-455a085ef14d","resolution":{"observed_at":"2026-08-05T20:46:54.657258Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T20:46:54.646239Z","title":"Emergence of simple- cell receptive field properties by learning a sparse code for natural images","venue":null,"work_id":"d179e9d0-3a94-4410-b0f8-1b4e0cd3285c","year":1996},"citing_paper":{"arxiv_id":"2508.09959","last_updated":"2025-08-13T17:22:05Z","snapshot_observed_at":"2026-08-07T22:09:59.442556Z","submitted_at":"2025-08-13T17:22:05Z","title":"LIA-X: Interpretable Latent Portrait Animator","version":1},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-05T20:46:54.193350Z"},"links":{"citing_paper":"/paper/2508.09959"},"observation_digest":"sha256:979e1e2004b36a1bb02611d9fb64b18fd1fe7f47726421780b9b7e6de5373ea2","observation_id":"68469150-5edd-4372-a1c5-0388dc21cf76","resolution":{"observed_at":"2026-08-05T20:46:54.649093Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2212.09748","last_updated":"2023-03-02T09:06:55Z","snapshot_observed_at":"2026-07-06T14:32:37.317828Z","submitted_at":"2022-12-19T18:59:58Z","title":"Scalable Diffusion Models with Transformers","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2212.09748","snapshot_observed_at":"2026-08-05T20:46:54.195863Z","title":"Scalable diffusion models with transformers","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2508.09959","last_updated":"2025-08-13T17:22:05Z","snapshot_observed_at":"2026-08-07T22:09:59.442556Z","submitted_at":"2025-08-13T17:22:05Z","title":"LIA-X: Interpretable Latent Portrait Animator","version":1},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-08-05T20:46:54.195863Z"},"links":{"cited_paper":"/paper/2212.09748","citing_paper":"/paper/2508.09959"},"observation_digest":"sha256:db5772a2b991c33d00dd5b4ba2011dec04dff262cec521fabdc025b9db4bd83c","observation_id":"0571ae8f-d37b-403b-a99f-728c7a2248d3","resolution":{"observed_at":"2026-08-05T20:46:54.195863Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T20:46:54.637046Z","title":"Tempo- ral generative adversarial nets with singular value clipping","venue":null,"work_id":"d075341f-ef9f-41ca-87cb-3fdc4a0f86ae","year":2017},"citing_paper":{"arxiv_id":"2508.09959","last_updated":"2025-08-13T17:22:05Z","snapshot_observed_at":"2026-08-07T22:09:59.442556Z","submitted_at":"2025-08-13T17:22:05Z","title":"LIA-X: Interpretable Latent Portrait Animator","version":1},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-08-05T20:46:54.198711Z"},"links":{"citing_paper":"/paper/2508.09959"},"observation_digest":"sha256:1078c804d0833e638cb9bff267f3efc1782e52acd5136466cb7f315402d06308","observation_id":"3b9de7d9-9977-46b4-a1e0-316cab554298","resolution":{"observed_at":"2026-08-05T20:46:54.639938Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T20:46:54.628289Z","title":"StyleGAN-T: Unlocking the power of GANs for fast large-scale text-to-image synthesis","venue":null,"work_id":"f223b6d0-1553-4ee6-81c8-92b7a9391dc0","year":2023},"citing_paper":{"arxiv_id":"2508.09959","last_updated":"2025-08-13T17:22:05Z","snapshot_observed_at":"2026-08-07T22:09:59.442556Z","submitted_at":"2025-08-13T17:22:05Z","title":"LIA-X: Interpretable Latent Portrait Animator","version":1},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-08-05T20:46:54.201291Z"},"links":{"citing_paper":"/paper/2508.09959"},"observation_digest":"sha256:327d425c2675f952b13cb84bf0f6b62ee1062b671e7fa4401a4a85fe6ed49787","observation_id":"a7582b50-baee-4e8c-86b5-90f0f2faaa0d","resolution":{"observed_at":"2026-08-05T20:46:54.631246Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T20:46:54.619452Z","title":"First order motion model for image animation","venue":null,"work_id":"c4bbe295-e27c-4db1-8ebc-62e2a41a39ea","year":2019},"citing_paper":{"arxiv_id":"2508.09959","last_updated":"2025-08-13T17:22:05Z","snapshot_observed_at":"2026-08-07T22:09:59.442556Z","submitted_at":"2025-08-13T17:22:05Z","title":"LIA-X: Interpretable Latent Portrait Animator","version":1},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-08-05T20:46:54.203931Z"},"links":{"citing_paper":"/paper/2508.09959"},"observation_digest":"sha256:3199d58def2f39e2c13a47f570f273c849b26e4eaa48fd9cd0e240427c76a81a","observation_id":"2d39c415-ffee-4791-8b9b-ebab1c565370","resolution":{"observed_at":"2026-08-05T20:46:54.622358Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T20:46:54.610560Z","title":"Motion representations for ar- ticulated animation","venue":null,"work_id":"39d8991f-d465-4990-a15a-585f234f3018","year":2021},"citing_paper":{"arxiv_id":"2508.09959","last_updated":"2025-08-13T17:22:05Z","snapshot_observed_at":"2026-08-07T22:09:59.442556Z","submitted_at":"2025-08-13T17:22:05Z","title":"LIA-X: Interpretable Latent Portrait Animator","version":1},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-08-05T20:46:54.207064Z"},"links":{"citing_paper":"/paper/2508.09959"},"observation_digest":"sha256:a9bfb8b1757c87b536531f50111a4aeb88691bc424f07e22f7f53b769b35fa62","observation_id":"40d1679e-ebd8-4f0b-9dcb-07b4df5ad13d","resolution":{"observed_at":"2026-08-05T20:46:54.613860Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T20:46:54.602506Z","title":"Make-a-video: Text-to-video generation without text-video data","venue":null,"work_id":"1b841009-5f41-41a6-bc20-a79d5a50b8bd","year":2023},"citing_paper":{"arxiv_id":"2508.09959","last_updated":"2025-08-13T17:22:05Z","snapshot_observed_at":"2026-08-07T22:09:59.442556Z","submitted_at":"2025-08-13T17:22:05Z","title":"LIA-X: Interpretable Latent Portrait Animator","version":1},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-08-05T20:46:54.209654Z"},"links":{"citing_paper":"/paper/2508.09959"},"observation_digest":"sha256:47eaf622dc2a7131d63a8ff0cb06b5afdbfb0823258d9a006a292ea76189a196","observation_id":"4942ae01-b218-454a-afee-c0344d009925","resolution":{"observed_at":"2026-08-05T20:46:54.605280Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T20:46:54.593764Z","title":"Stylegan-v: A continuous video generator with the price, image quality and perks of stylegan2","venue":null,"work_id":"114e6ea1-9868-4169-8cbd-5adec75ecc66","year":2022},"citing_paper":{"arxiv_id":"2508.09959","last_updated":"2025-08-13T17:22:05Z","snapshot_observed_at":"2026-08-07T22:09:59.442556Z","submitted_at":"2025-08-13T17:22:05Z","title":"LIA-X: Interpretable Latent Portrait Animator","version":1},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-08-05T20:46:54.212606Z"},"links":{"citing_paper":"/paper/2508.09959"},"observation_digest":"sha256:7d470deea3e5cf9a0dbefa1957f2c0f933ad974a687d28980bfa4e46e90063de","observation_id":"004c71b5-2596-4a53-94bd-8cdadc2212e9","resolution":{"observed_at":"2026-08-05T20:46:54.597211Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T20:46:54.215433Z","title":"Denois- ing diffusion implicit models","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2508.09959","last_updated":"2025-08-13T17:22:05Z","snapshot_observed_at":"2026-08-07T22:09:59.442556Z","submitted_at":"2025-08-13T17:22:05Z","title":"LIA-X: Interpretable Latent Portrait Animator","version":1},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-08-05T20:46:54.215433Z"},"links":{"citing_paper":"/paper/2508.09959"},"observation_digest":"sha256:8e88030a4c1dc7033044566946c20212bfe0a1d3f176979b5c63e16ac79e88ab","observation_id":"838df8df-0572-484c-a9a2-7e07e8dc432d","resolution":{"observed_at":"2026-08-05T20:46:54.215433Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T20:46:54.580826Z","title":"Blindly assess image qual- ity in the wild guided by a self-adaptive hyper network","venue":null,"work_id":"457d87b6-092a-4a77-aca2-1a0a94a0c818","year":2020},"citing_paper":{"arxiv_id":"2508.09959","last_updated":"2025-08-13T17:22:05Z","snapshot_observed_at":"2026-08-07T22:09:59.442556Z","submitted_at":"2025-08-13T17:22:05Z","title":"LIA-X: Interpretable Latent Portrait Animator","version":1},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-08-05T20:46:54.218029Z"},"links":{"citing_paper":"/paper/2508.09959"},"observation_digest":"sha256:6392f61be1c9c4c0965e2c29ca36757ca2edc0803d52f44d9f25da7f9d34855e","observation_id":"410a1d7d-ff0e-4be3-b671-01823120efc7","resolution":{"observed_at":"2026-08-05T20:46:54.583602Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T20:46:54.572697Z","title":"Metaxas, and Sergey Tulyakov","venue":null,"work_id":"427ffda2-12cb-446f-bdb5-09e30bcdd816","year":2021},"citing_paper":{"arxiv_id":"2508.09959","last_updated":"2025-08-13T17:22:05Z","snapshot_observed_at":"2026-08-07T22:09:59.442556Z","submitted_at":"2025-08-13T17:22:05Z","title":"LIA-X: Interpretable Latent Portrait Animator","version":1},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-08-05T20:46:54.220965Z"},"links":{"citing_paper":"/paper/2508.09959"},"observation_digest":"sha256:640a2a0dce21adaa13ab4a8121665f8adf04db53a8d0ad52a9fe38677f1fa7e2","observation_id":"75ee3ea5-0cc6-4c1b-ac0e-38a59efcbe8f","resolution":{"observed_at":"2026-08-05T20:46:54.575305Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T20:46:54.565081Z","title":"MoCoGAN: Decomposing motion and content for video generation","venue":null,"work_id":"a9d78f2a-a300-4d31-a982-53c2d7510936","year":2018},"citing_paper":{"arxiv_id":"2508.09959","last_updated":"2025-08-13T17:22:05Z","snapshot_observed_at":"2026-08-07T22:09:59.442556Z","submitted_at":"2025-08-13T17:22:05Z","title":"LIA-X: Interpretable Latent Portrait Animator","version":1},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-08-05T20:46:54.223750Z"},"links":{"citing_paper":"/paper/2508.09959"},"observation_digest":"sha256:29ac697a2a7c8857190f094fff2f05d89b51fa1cf7e5a7b69afd533fdb1e503a","observation_id":"332f6aba-1574-48c8-8824-1ea3231ac04f","resolution":{"observed_at":"2026-08-05T20:46:54.567859Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T20:46:54.557384Z","title":"Generating videos with scene dynamics","venue":null,"work_id":"d660e27e-7c4e-4073-bbbf-d99ebdb90c08","year":2016},"citing_paper":{"arxiv_id":"2508.09959","last_updated":"2025-08-13T17:22:05Z","snapshot_observed_at":"2026-08-07T22:09:59.442556Z","submitted_at":"2025-08-13T17:22:05Z","title":"LIA-X: Interpretable Latent Portrait Animator","version":1},"reference_index":36,"source":"pdf_text","source_observed_at":"2026-08-05T20:46:54.226525Z"},"links":{"citing_paper":"/paper/2508.09959"},"observation_digest":"sha256:b2c6087e78b4007fae006848e9db9e20b3a933ef19b44b35931ba91f944c5758","observation_id":"e0fa7279-db62-48c1-9c0e-c7875d8add60","resolution":{"observed_at":"2026-08-05T20:46:54.560052Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T20:46:54.549051Z","title":"Mead: A large-scale audio-visual dataset for emotional talking-face generation","venue":null,"work_id":"f1329aa8-ae61-4df9-af60-f4e4070ba30d","year":2020},"citing_paper":{"arxiv_id":"2508.09959","last_updated":"2025-08-13T17:22:05Z","snapshot_observed_at":"2026-08-07T22:09:59.442556Z","submitted_at":"2025-08-13T17:22:05Z","title":"LIA-X: Interpretable Latent Portrait Animator","version":1},"reference_index":37,"source":"pdf_text","source_observed_at":"2026-08-05T20:46:54.229283Z"},"links":{"citing_paper":"/paper/2508.09959"},"observation_digest":"sha256:cc0355b1a67cdf8326210ad1690724b67ffb5aa7fd05744e422eba860c350afa","observation_id":"e7616339-454c-4728-bf10-de2677ebd462","resolution":{"observed_at":"2026-08-05T20:46:54.551871Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T20:46:54.540987Z","title":"Video-to- video synthesis","venue":null,"work_id":"88a4d81d-ab49-40cb-8e0b-d711288cf11a","year":2018},"citing_paper":{"arxiv_id":"2508.09959","last_updated":"2025-08-13T17:22:05Z","snapshot_observed_at":"2026-08-07T22:09:59.442556Z","submitted_at":"2025-08-13T17:22:05Z","title":"LIA-X: Interpretable Latent Portrait Animator","version":1},"reference_index":38,"source":"pdf_text","source_observed_at":"2026-08-05T20:46:54.231644Z"},"links":{"citing_paper":"/paper/2508.09959"},"observation_digest":"sha256:084a442b34e54527176bc7e3086ab23621c2ca6c6ebbfb9df8542764bae7c2c7","observation_id":"f91b7d8d-ab3d-4688-be9e-e3ef56be82ae","resolution":{"observed_at":"2026-08-05T20:46:54.543586Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T20:46:54.532714Z","title":"Few-shot video-to-video synthesis","venue":null,"work_id":"534f2aeb-3004-46a2-a779-54ec8dba0b6f","year":2019},"citing_paper":{"arxiv_id":"2508.09959","last_updated":"2025-08-13T17:22:05Z","snapshot_observed_at":"2026-08-07T22:09:59.442556Z","submitted_at":"2025-08-13T17:22:05Z","title":"LIA-X: Interpretable Latent Portrait Animator","version":1},"reference_index":39,"source":"pdf_text","source_observed_at":"2026-08-05T20:46:54.234067Z"},"links":{"citing_paper":"/paper/2508.09959"},"observation_digest":"sha256:cef4bf7fdf0447a8e22e3e460b2acd6837d55fdaea5fa9dc30720b63aed166dd","observation_id":"cdd97b47-f28f-4c06-b116-db83cc37e1c9","resolution":{"observed_at":"2026-08-05T20:46:54.536085Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T20:46:54.524927Z","title":"One-shot free-view neural talking-head synthesis for video conferenc- ing","venue":null,"work_id":"525a46e5-99a1-46c8-b8ea-650ff1bf75fc","year":2021},"citing_paper":{"arxiv_id":"2508.09959","last_updated":"2025-08-13T17:22:05Z","snapshot_observed_at":"2026-08-07T22:09:59.442556Z","submitted_at":"2025-08-13T17:22:05Z","title":"LIA-X: Interpretable Latent Portrait Animator","version":1},"reference_index":40,"source":"pdf_text","source_observed_at":"2026-08-05T20:46:54.236482Z"},"links":{"citing_paper":"/paper/2508.09959"},"observation_digest":"sha256:35403449146ba5aed87622688ae9bd1ddd25b89ded2628772fded4807fb00951","observation_id":"2def8e80-1540-43ce-ac67-47a20d6ab802","resolution":{"observed_at":"2026-08-05T20:46:54.527792Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T20:46:54.517247Z","title":"Learning to Generate Human Videos","venue":null,"work_id":"cf9ba313-d749-4556-ae6a-ed24a6fc1479","year":2021},"citing_paper":{"arxiv_id":"2508.09959","last_updated":"2025-08-13T17:22:05Z","snapshot_observed_at":"2026-08-07T22:09:59.442556Z","submitted_at":"2025-08-13T17:22:05Z","title":"LIA-X: Interpretable Latent Portrait Animator","version":1},"reference_index":41,"source":"pdf_text","source_observed_at":"2026-08-05T20:46:54.239133Z"},"links":{"citing_paper":"/paper/2508.09959"},"observation_digest":"sha256:a60036ac02c02c24cc9fde51196e1f0a8fd377523a838c7cfd3ddf2d0845cb89","observation_id":"f7c303cc-2024-4b97-bf57-cb1b3af2569a","resolution":{"observed_at":"2026-08-05T20:46:54.519831Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T20:46:54.508720Z","title":"G3AN: Disentangling appearance and motion for video generation","venue":null,"work_id":"893dc54d-f24d-4d78-9df6-a89ba5f18979","year":2020},"citing_paper":{"arxiv_id":"2508.09959","last_updated":"2025-08-13T17:22:05Z","snapshot_observed_at":"2026-08-07T22:09:59.442556Z","submitted_at":"2025-08-13T17:22:05Z","title":"LIA-X: Interpretable Latent Portrait Animator","version":1},"reference_index":42,"source":"pdf_text","source_observed_at":"2026-08-05T20:46:54.241371Z"},"links":{"citing_paper":"/paper/2508.09959"},"observation_digest":"sha256:60f3272e2ae0974c8bd1cb9ad70c4b02fd335eaa7c35f0b01a282f4b8c1dc673","observation_id":"e2fb5de9-0cf1-4f2f-97c8-d08fb0a71f96","resolution":{"observed_at":"2026-08-05T20:46:54.511771Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T20:46:54.500499Z","title":"ImaGINator: Conditional Spatio-Temporal GAN for Video Generation","venue":null,"work_id":"878b426b-6ff9-4263-aaac-5f528ffbcd96","year":2020},"citing_paper":{"arxiv_id":"2508.09959","last_updated":"2025-08-13T17:22:05Z","snapshot_observed_at":"2026-08-07T22:09:59.442556Z","submitted_at":"2025-08-13T17:22:05Z","title":"LIA-X: Interpretable Latent Portrait Animator","version":1},"reference_index":43,"source":"pdf_text","source_observed_at":"2026-08-05T20:46:54.243750Z"},"links":{"citing_paper":"/paper/2508.09959"},"observation_digest":"sha256:089b42b3e002bfcbcf9e27d8a7f4dce94cf09b9ef90891c202983e4609c72f72","observation_id":"09e25815-99be-457a-b0c6-8cb2532c55fd","resolution":{"observed_at":"2026-08-05T20:46:54.503746Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2101.03049","last_updated":"2021-01-08T15:02:28Z","snapshot_observed_at":"2026-08-07T14:09:40.654122Z","submitted_at":"2021-01-08T15:02:28Z","title":"InMoDeGAN: Interpretable Motion Decomposition Generative Adversarial Network for Video Generation","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2101.03049","snapshot_observed_at":"2026-08-05T20:46:54.246176Z","title":"Inmodegan: Interpretable motion decomposition generative adversarial network for video generation","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2508.09959","last_updated":"2025-08-13T17:22:05Z","snapshot_observed_at":"2026-08-07T22:09:59.442556Z","submitted_at":"2025-08-13T17:22:05Z","title":"LIA-X: Interpretable Latent Portrait Animator","version":1},"reference_index":44,"source":"pdf_text","source_observed_at":"2026-08-05T20:46:54.246176Z"},"links":{"cited_paper":"/paper/2101.03049","citing_paper":"/paper/2508.09959"},"observation_digest":"sha256:f27e02d46a9f00ad3b31796b5c508f15b8da520dfce0cdc2cac6da9915e88b33","observation_id":"cedc1872-957e-4dc7-8b0c-d8ff5a841e83","resolution":{"observed_at":"2026-08-05T20:46:54.246176Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T20:46:54.492234Z","title":"Latent image animator: Learning to animate im- ages via latent space navigation","venue":null,"work_id":"08d898cd-c622-449a-94bf-2c744f48c16d","year":2022},"citing_paper":{"arxiv_id":"2508.09959","last_updated":"2025-08-13T17:22:05Z","snapshot_observed_at":"2026-08-07T22:09:59.442556Z","submitted_at":"2025-08-13T17:22:05Z","title":"LIA-X: Interpretable Latent Portrait Animator","version":1},"reference_index":45,"source":"pdf_text","source_observed_at":"2026-08-05T20:46:54.248909Z"},"links":{"citing_paper":"/paper/2508.09959"},"observation_digest":"sha256:a4cf4f022174d4109758f01338e7c7e45a2a52cd627f336f9925f1d22acb3643","observation_id":"d7df6231-b489-49e7-956b-ab3199c53ee4","resolution":{"observed_at":"2026-08-05T20:46:54.495037Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2309.15103","last_updated":"2023-09-27T03:51:52Z","snapshot_observed_at":"2026-07-06T16:23:57.143116Z","submitted_at":"2023-09-26T17:52:03Z","title":"LAVIE: High-Quality Video Generation with Cascaded Latent Diffusion Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2309.15103","snapshot_observed_at":"2026-08-05T20:46:54.251157Z","title":"Lavie: High-quality video gener- ation with cascaded latent diffusion models","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2508.09959","last_updated":"2025-08-13T17:22:05Z","snapshot_observed_at":"2026-08-07T22:09:59.442556Z","submitted_at":"2025-08-13T17:22:05Z","title":"LIA-X: Interpretable Latent Portrait Animator","version":1},"reference_index":46,"source":"pdf_text","source_observed_at":"2026-08-05T20:46:54.251157Z"},"links":{"cited_paper":"/paper/2309.15103","citing_paper":"/paper/2508.09959"},"observation_digest":"sha256:0faa8741ab549611c3f07df53b1bf5cb2fdaa93289754c80d70b5eb8034b02d2","observation_id":"538597d6-3c36-4ef4-9650-2901dd930386","resolution":{"observed_at":"2026-08-05T20:46:54.251157Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2305.03989","last_updated":"2024-11-12T09:52:53Z","snapshot_observed_at":"2026-08-08T08:14:08.553905Z","submitted_at":"2023-05-06T09:29:12Z","title":"LEO: Generative Latent Image Animator for Human Video Synthesis","version":3},"cited_work":{"arxiv_id":"2305.03989","doi":null,"metadata_source":"pith","pith_arxiv_id":"2305.03989","snapshot_observed_at":"2026-08-05T20:46:54.318675Z","title":"LEO: Generative Latent Image Animator for Human Video Synthesis","venue":"cs.CV","work_id":"9182a058-2609-408c-acf3-d1da1ef18a4c","year":2023},"citing_paper":{"arxiv_id":"2508.09959","last_updated":"2025-08-13T17:22:05Z","snapshot_observed_at":"2026-08-07T22:09:59.442556Z","submitted_at":"2025-08-13T17:22:05Z","title":"LIA-X: Interpretable Latent Portrait Animator","version":1},"reference_index":47,"source":"pdf_text","source_observed_at":"2026-08-05T20:46:54.253977Z"},"links":{"cited_paper":"/paper/2305.03989","citing_paper":"/paper/2508.09959"},"observation_digest":"sha256:c33832aa1db64f4da2bfd9edb50cda3fe94af9cc3f856778121cda78d35467dd","observation_id":"da2694ec-e1b2-45b4-9990-d595d2a247d5","resolution":{"observed_at":"2026-08-05T20:46:54.323903Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T20:46:54.484081Z","title":"Lia: Latent image animator","venue":null,"work_id":"d1ce93ab-0150-4316-bb2e-c9fdd53084c0","year":null},"citing_paper":{"arxiv_id":"2508.09959","last_updated":"2025-08-13T17:22:05Z","snapshot_observed_at":"2026-08-07T22:09:59.442556Z","submitted_at":"2025-08-13T17:22:05Z","title":"LIA-X: Interpretable Latent Portrait Animator","version":1},"reference_index":48,"source":"pdf_text","source_observed_at":"2026-08-05T20:46:54.256663Z"},"links":{"citing_paper":"/paper/2508.09959"},"observation_digest":"sha256:7d9e819c6e50bc85e4f910d2c0106597f77b3f529b9fdcfa532afab49809ed51","observation_id":"e3629ca6-69a9-452c-bcef-6d24af18f3da","resolution":{"observed_at":"2026-08-05T20:46:54.486832Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T20:46:54.475575Z","title":"X-portrait: Expressive portrait anima- tion with hierarchical motion attention","venue":null,"work_id":"b35648d2-be7e-4c2c-b112-a8b2246d6982","year":2024},"citing_paper":{"arxiv_id":"2508.09959","last_updated":"2025-08-13T17:22:05Z","snapshot_observed_at":"2026-08-07T22:09:59.442556Z","submitted_at":"2025-08-13T17:22:05Z","title":"LIA-X: Interpretable Latent Portrait Animator","version":1},"reference_index":49,"source":"pdf_text","source_observed_at":"2026-08-05T20:46:54.259162Z"},"links":{"citing_paper":"/paper/2508.09959"},"observation_digest":"sha256:75dc785f40958cac5b4d1d7c5b49323e9a5eae88fdd96485446fb3568e934de0","observation_id":"9499e5db-fff3-4e55-86e3-4b42615e212e","resolution":{"observed_at":"2026-08-05T20:46:54.478917Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T20:46:54.467421Z","title":"Omniavatar: Geometry-guided controllable 3d head synthesis","venue":null,"work_id":"9e895c68-84ae-4e42-a079-86f8edd3ea9e","year":2023},"citing_paper":{"arxiv_id":"2508.09959","last_updated":"2025-08-13T17:22:05Z","snapshot_observed_at":"2026-08-07T22:09:59.442556Z","submitted_at":"2025-08-13T17:22:05Z","title":"LIA-X: Interpretable Latent Portrait Animator","version":1},"reference_index":50,"source":"pdf_text","source_observed_at":"2026-08-05T20:46:54.261649Z"},"links":{"citing_paper":"/paper/2508.09959"},"observation_digest":"sha256:92699d9c6f3ed7edaf86b441de2698d855b044a8a42bcc0e36e921784b3df31e","observation_id":"2442e814-c905-4f27-8770-79a805aae71f","resolution":{"observed_at":"2026-08-05T20:46:54.470448Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2104.10157","last_updated":"2021-09-14T21:20:06Z","snapshot_observed_at":"2026-07-06T11:02:11.424356Z","submitted_at":"2021-04-20T17:58:03Z","title":"VideoGPT: Video Generation using VQ-VAE and Transformers","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2104.10157","snapshot_observed_at":"2026-08-05T20:46:54.264040Z","title":"Videogpt: Video generation using vq-vae and trans- formers","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2508.09959","last_updated":"2025-08-13T17:22:05Z","snapshot_observed_at":"2026-08-07T22:09:59.442556Z","submitted_at":"2025-08-13T17:22:05Z","title":"LIA-X: Interpretable Latent Portrait Animator","version":1},"reference_index":51,"source":"pdf_text","source_observed_at":"2026-08-05T20:46:54.264040Z"},"links":{"cited_paper":"/paper/2104.10157","citing_paper":"/paper/2508.09959"},"observation_digest":"sha256:0c9d1218fcbe233681cc323a1046f961b65d110c65057fe82e4473de86b10070","observation_id":"82cd1881-b648-450a-92d2-f980ba2f2982","resolution":{"observed_at":"2026-08-05T20:46:54.264040Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T20:46:54.458586Z","title":"Transmomo: Invariance-driven unsupervised video motion retargeting","venue":null,"work_id":"8dde8bda-15dc-4ae9-9914-e72554cc7562","year":2020},"citing_paper":{"arxiv_id":"2508.09959","last_updated":"2025-08-13T17:22:05Z","snapshot_observed_at":"2026-08-07T22:09:59.442556Z","submitted_at":"2025-08-13T17:22:05Z","title":"LIA-X: Interpretable Latent Portrait Animator","version":1},"reference_index":52,"source":"pdf_text","source_observed_at":"2026-08-05T20:46:54.266580Z"},"links":{"citing_paper":"/paper/2508.09959"},"observation_digest":"sha256:35c4e734d26623c95acabaaef5e86fe560c4a0f1b6a0041ed2cf5fe35ac40137","observation_id":"70b075d4-9154-4fda-9343-a24d3a38bf3f","resolution":{"observed_at":"2026-08-05T20:46:54.461700Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T20:46:54.448054Z","title":"Generating videos with dynamics-aware implicit generative adversarial net- works","venue":null,"work_id":"70c4cd19-fa19-48a0-b312-88a57e8d4191","year":2022},"citing_paper":{"arxiv_id":"2508.09959","last_updated":"2025-08-13T17:22:05Z","snapshot_observed_at":"2026-08-07T22:09:59.442556Z","submitted_at":"2025-08-13T17:22:05Z","title":"LIA-X: Interpretable Latent Portrait Animator","version":1},"reference_index":53,"source":"pdf_text","source_observed_at":"2026-08-05T20:46:54.269423Z"},"links":{"citing_paper":"/paper/2508.09959"},"observation_digest":"sha256:f6739f9fafdabb3c00e60567c62231adcb1565aff28d7f42a6c0c60b21eb7593","observation_id":"1a0f97b1-69e3-486b-a2db-22d1517988f1","resolution":{"observed_at":"2026-08-05T20:46:54.451893Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T20:46:54.437659Z","title":"Toontalker: Cross-domain face reenactment, 2023","venue":null,"work_id":"b10c6f71-79bd-4286-92aa-8a38b51750db","year":2023},"citing_paper":{"arxiv_id":"2508.09959","last_updated":"2025-08-13T17:22:05Z","snapshot_observed_at":"2026-08-07T22:09:59.442556Z","submitted_at":"2025-08-13T17:22:05Z","title":"LIA-X: Interpretable Latent Portrait Animator","version":1},"reference_index":54,"source":"pdf_text","source_observed_at":"2026-08-05T20:46:54.271775Z"},"links":{"citing_paper":"/paper/2508.09959"},"observation_digest":"sha256:1b7b6deeee118b404a722f8daf7e5ff0c0de9027e3370a1ef1f828bd611b0bae","observation_id":"8f91d0f4-0eec-40a1-a3fa-32bd482f02c0","resolution":{"observed_at":"2026-08-05T20:46:54.440984Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T20:46:54.426833Z","title":"Few-shot adversarial learning of realis- tic neural talking head models","venue":null,"work_id":"d4b5e8cb-c806-4fc1-8d82-c760428cc7fb","year":2019},"citing_paper":{"arxiv_id":"2508.09959","last_updated":"2025-08-13T17:22:05Z","snapshot_observed_at":"2026-08-07T22:09:59.442556Z","submitted_at":"2025-08-13T17:22:05Z","title":"LIA-X: Interpretable Latent Portrait Animator","version":1},"reference_index":55,"source":"pdf_text","source_observed_at":"2026-08-05T20:46:54.274246Z"},"links":{"citing_paper":"/paper/2508.09959"},"observation_digest":"sha256:f307ca180a5b030d6a8108372f6ee33d665bd79edaec77457f8da798587571b5","observation_id":"f80d463d-d8c1-4f50-b5a3-d2284d7fd9b9","resolution":{"observed_at":"2026-08-05T20:46:54.430498Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T20:46:54.418121Z","title":"Show-1: Marrying pixel and latent diffusion models for text-to-video generation","venue":null,"work_id":"cdf2c7f9-40ed-4e79-a55f-f91ab5b1ef9e","year":2024},"citing_paper":{"arxiv_id":"2508.09959","last_updated":"2025-08-13T17:22:05Z","snapshot_observed_at":"2026-08-07T22:09:59.442556Z","submitted_at":"2025-08-13T17:22:05Z","title":"LIA-X: Interpretable Latent Portrait Animator","version":1},"reference_index":56,"source":"pdf_text","source_observed_at":"2026-08-05T20:46:54.276818Z"},"links":{"citing_paper":"/paper/2508.09959"},"observation_digest":"sha256:8abb4a0c504a961a33479235e9f3fe20ecaf2d2fc0f44e3e2ae6c11484efa2dc","observation_id":"32124425-4c7f-4e6a-89e0-4f85c6d957c3","resolution":{"observed_at":"2026-08-05T20:46:54.421151Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T20:46:54.409435Z","title":"Flow-guided one-shot talking face generation with a high- resolution audio-visual dataset","venue":null,"work_id":"bf34ab29-794f-4e17-ae0e-49a50d90482c","year":2021},"citing_paper":{"arxiv_id":"2508.09959","last_updated":"2025-08-13T17:22:05Z","snapshot_observed_at":"2026-08-07T22:09:59.442556Z","submitted_at":"2025-08-13T17:22:05Z","title":"LIA-X: Interpretable Latent Portrait Animator","version":1},"reference_index":57,"source":"pdf_text","source_observed_at":"2026-08-05T20:46:54.279556Z"},"links":{"citing_paper":"/paper/2508.09959"},"observation_digest":"sha256:67aff99f8044ead14234218c19959c3af31527107ce43830ae207043b181844f","observation_id":"ffb87620-4952-4d2c-b637-2027376d663a","resolution":{"observed_at":"2026-08-05T20:46:54.412250Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T20:46:54.400954Z","title":"Thin-plate spline motion model for image animation","venue":null,"work_id":"4b66e004-bcfe-4e6c-8199-898a45bb51e7","year":2022},"citing_paper":{"arxiv_id":"2508.09959","last_updated":"2025-08-13T17:22:05Z","snapshot_observed_at":"2026-08-07T22:09:59.442556Z","submitted_at":"2025-08-13T17:22:05Z","title":"LIA-X: Interpretable Latent Portrait Animator","version":1},"reference_index":58,"source":"pdf_text","source_observed_at":"2026-08-05T20:46:54.281971Z"},"links":{"citing_paper":"/paper/2508.09959"},"observation_digest":"sha256:e7725a19ecf38ff4f44a038e2c30acec7eaa69aba9b45eaa9f1083f8122ff8e1","observation_id":"a2675240-c3e1-45e5-af02-e0f62eef8f15","resolution":{"observed_at":"2026-08-05T20:46:54.403940Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}}],"paper":{"arxiv_id":"2508.09959","last_updated":"2025-08-13T17:22:05Z","latest_version":1,"primary_category":"cs.CV","snapshot_observed_at":"2026-08-07T22:09:59.442556Z","submitted_at":"2025-08-13T17:22:05Z","title":"LIA-X: Interpretable Latent Portrait Animator"},"reference_resolution":{"displayed":58,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":12,"verified_exact":1,"verified_fuzzy":45},"total_outbound_references":58},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"thesis":"As of 12 August 2026, this Paper Citation Record lists 58 of 58 outbound references and 3 inbound Pith citation observations for arXiv:2508.09959."}