{"as_of":"2026-08-09T05:15:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:d223fa4ed16d710ffaf1085875711c26ff14deacdff433f1ea0ad80fd3299475","coverage":[{"denominator":19,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":19,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-07T21:11:25.361857Z","state":"measured"},{"denominator":35,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":35,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-08T06:32:00.761636+00:00","state":"measured"},{"denominator":16,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":16,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-07T14:48:49.919295Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"arxiv_reference","source_observed_at":"2026-07-01T22:16:15.690225Z","state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2502.09533","last_updated":"2025-02-13T17:50:23Z","snapshot_observed_at":"2026-08-07T22:10:29.240376Z","submitted_at":"2025-02-13T17:50:23Z","title":"Long-Term TalkingFace Generation via Motion-Prior Conditional Diffusion Model","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2502.09533","snapshot_observed_at":"2026-08-07T14:48:49.919295Z","title":"arXiv preprint arXiv:2502.09533 (2025)","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2505.17544","last_updated":"2025-05-23T06:51:24Z","snapshot_observed_at":"2026-08-07T22:11:00.566923Z","submitted_at":"2025-05-23T06:51:24Z","title":"FreqU-FNet: Frequency-Aware U-Net for Imbalanced Medical Image Segmentation","version":1},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-07T14:48:49.919295Z"},"links":{"cited_paper":"/paper/2502.09533","citing_paper":"/paper/2505.17544"},"observation_digest":"sha256:2477255720e7b96d088c500e8d173c0962f62e3c9f984fe668d8048dc4585894","observation_id":"3bbc9556-31cc-4f64-8e66-4e665249c7e8","resolution":{"observed_at":"2026-08-07T14:48:49.919295Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2502.09533","last_updated":"2025-02-13T17:50:23Z","snapshot_observed_at":"2026-08-07T22:10:29.240376Z","submitted_at":"2025-02-13T17:50:23Z","title":"Long-Term TalkingFace Generation via Motion-Prior Conditional Diffusion Model","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2502.09533","snapshot_observed_at":"2026-08-07T14:44:50.717732Z","title":"Long-Term TalkingFace Generation via Motion-Prior Conditional Diffu- sion Model,","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2505.17683","last_updated":"2025-06-10T04:20:37Z","snapshot_observed_at":"2026-08-08T12:30:39.206748Z","submitted_at":"2025-05-23T09:53:57Z","title":"Dual Attention Residual U-Net for Accurate Brain Ultrasound Segmentation in IVH Detection","version":2},"reference_index":38,"source":"pdf_text","source_observed_at":"2026-08-07T14:44:50.717732Z"},"links":{"cited_paper":"/paper/2502.09533","citing_paper":"/paper/2505.17683"},"observation_digest":"sha256:c930cb36403c25489d330c9ebc7b7ca41ee40287ba433d39e1ab51fbc036f1f0","observation_id":"8e983138-1c63-4ddb-9ceb-a484a72e6334","resolution":{"observed_at":"2026-08-07T14:44:50.717732Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2502.09533","last_updated":"2025-02-13T17:50:23Z","snapshot_observed_at":"2026-08-07T22:10:29.240376Z","submitted_at":"2025-02-13T17:50:23Z","title":"Long-Term TalkingFace Generation via Motion-Prior Conditional Diffusion Model","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2502.09533","snapshot_observed_at":"2026-08-07T13:34:17.772336Z","title":"Long-term talkingface generation via motion-prior conditional diffusion model,","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2505.21370","last_updated":"2025-05-27T16:00:34Z","snapshot_observed_at":"2026-08-07T13:26:36.846155Z","submitted_at":"2025-05-27T16:00:34Z","title":"YOLO-SPCI: Enhancing Remote Sensing Object Detection via Selective-Perspective-Class Integration","version":1},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-07T13:34:17.772336Z"},"links":{"cited_paper":"/paper/2502.09533","citing_paper":"/paper/2505.21370"},"observation_digest":"sha256:169a786aca7f564c0dc6008dbda7a30ff1e8a7dc58b7aa37a37796771520c858","observation_id":"5548222b-807e-48f8-80fb-d12458827668","resolution":{"observed_at":"2026-08-07T13:34:17.772336Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2502.09533","last_updated":"2025-02-13T17:50:23Z","snapshot_observed_at":"2026-08-07T22:10:29.240376Z","submitted_at":"2025-02-13T17:50:23Z","title":"Long-Term TalkingFace Generation via Motion-Prior Conditional Diffusion Model","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2502.09533","snapshot_observed_at":"2026-08-07T13:21:47.846974Z","title":"Long-term talkingface generation via motion-prior conditional diffusion model,","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2505.22141","last_updated":"2025-08-27T16:33:34Z","snapshot_observed_at":"2026-08-07T20:49:32.346427Z","submitted_at":"2025-05-28T09:04:00Z","title":"FaceEditTalker: Controllable Talking Head Generation with Facial Attribute Editing","version":2},"reference_index":47,"source":"pdf_text","source_observed_at":"2026-08-07T13:21:47.846974Z"},"links":{"cited_paper":"/paper/2502.09533","citing_paper":"/paper/2505.22141"},"observation_digest":"sha256:e63a8e2d4f8d3f37b3b95ce6fdd39df20122d24e0f2dee6dbeb95ed715b34e77","observation_id":"8a29db05-2531-4fd2-b4e9-6ba4bb767bd2","resolution":{"observed_at":"2026-08-07T13:21:47.846974Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2502.09533","last_updated":"2025-02-13T17:50:23Z","snapshot_observed_at":"2026-08-07T22:10:29.240376Z","submitted_at":"2025-02-13T17:50:23Z","title":"Long-Term TalkingFace Generation via Motion-Prior Conditional Diffusion Model","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2502.09533","snapshot_observed_at":"2026-08-07T12:51:42.530709Z","title":"Shen , author C","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2505.23365","last_updated":"2025-05-29T11:42:57Z","snapshot_observed_at":"2026-08-07T22:11:57.320582Z","submitted_at":"2025-05-29T11:42:57Z","title":"MCFNet: A Multimodal Collaborative Fusion Network for Fine-Grained Semantic Classification","version":1},"reference_index":40,"source":"arxiv_source","source_observed_at":"2026-08-07T12:51:42.530709Z"},"links":{"cited_paper":"/paper/2502.09533","citing_paper":"/paper/2505.23365"},"observation_digest":"sha256:313d977a3d80b4b4a6cb9eeb279179432ae4fa0851e1b970284ab020e22811bb","observation_id":"c5f665c0-e78c-4f46-91ee-eb4b089377e3","resolution":{"observed_at":"2026-08-07T12:51:42.530709Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2502.09533","last_updated":"2025-02-13T17:50:23Z","snapshot_observed_at":"2026-08-07T22:10:29.240376Z","submitted_at":"2025-02-13T17:50:23Z","title":"Long-Term TalkingFace Generation via Motion-Prior Conditional Diffusion Model","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2502.09533","snapshot_observed_at":"2026-08-07T12:25:15.204023Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2505.24481","last_updated":"2025-05-30T11:30:53Z","snapshot_observed_at":"2026-08-07T22:11:10.951739Z","submitted_at":"2025-05-30T11:30:53Z","title":"ACM-UNet: Adaptive Integration of CNNs and Mamba for Efficient Medical Image Segmentation","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-07T12:25:15.204023Z"},"links":{"cited_paper":"/paper/2502.09533","citing_paper":"/paper/2505.24481"},"observation_digest":"sha256:5b00068b660af2ea32372b115acf001c73877a062a53546fcd4178e9d0508359","observation_id":"3f790a3f-0da6-4c86-8c2a-7f5d5a4eb967","resolution":{"observed_at":"2026-08-07T12:25:15.204023Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2502.09533","last_updated":"2025-02-13T17:50:23Z","snapshot_observed_at":"2026-08-07T22:10:29.240376Z","submitted_at":"2025-02-13T17:50:23Z","title":"Long-Term TalkingFace Generation via Motion-Prior Conditional Diffusion Model","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2502.09533","snapshot_observed_at":"2026-08-07T01:07:27.514765Z","title":"Long-term talkingface generation via motion-prior conditional diffusion model,","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2506.11913","last_updated":"2025-06-13T16:06:51Z","snapshot_observed_at":"2026-08-09T04:58:09.255362Z","submitted_at":"2025-06-13T16:06:51Z","title":"O2Former:Direction-Aware and Multi-Scale Query Enhancement for SAR Ship Instance Segmentation","version":1},"reference_index":47,"source":"pdf_text","source_observed_at":"2026-08-07T01:07:27.514765Z"},"links":{"cited_paper":"/paper/2502.09533","citing_paper":"/paper/2506.11913"},"observation_digest":"sha256:caf5b9ed52078c22dda147c2e6b490378a7fcf092fd050706bd33f00df6e1aeb","observation_id":"e17b9bcc-12f1-45e0-933a-f8bf6f8fdb9c","resolution":{"observed_at":"2026-08-07T01:07:27.514765Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2502.09533","last_updated":"2025-02-13T17:50:23Z","snapshot_observed_at":"2026-08-07T22:10:29.240376Z","submitted_at":"2025-02-13T17:50:23Z","title":"Long-Term TalkingFace Generation via Motion-Prior Conditional Diffusion Model","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2502.09533","snapshot_observed_at":"2026-08-06T22:34:32.776804Z","title":"Long-term talkingface generation via motion-prior conditional diffusion model,","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2506.21135","last_updated":"2025-06-26T10:32:37Z","snapshot_observed_at":"2026-08-07T22:11:54.617341Z","submitted_at":"2025-06-26T10:32:37Z","title":"YOLO-FDA: Integrating Hierarchical Attention and Detail Enhancement for Surface Defect Detection","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-06T22:34:32.776804Z"},"links":{"cited_paper":"/paper/2502.09533","citing_paper":"/paper/2506.21135"},"observation_digest":"sha256:bc8ca773d960bda0c1e06011547731a38ae3bec12080a7c5079a5a86573ab76b","observation_id":"e680273a-eb9a-4af6-b8b9-2035517f8423","resolution":{"observed_at":"2026-08-06T22:34:32.776804Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2502.09533","last_updated":"2025-02-13T17:50:23Z","snapshot_observed_at":"2026-08-07T22:10:29.240376Z","submitted_at":"2025-02-13T17:50:23Z","title":"Long-Term TalkingFace Generation via Motion-Prior Conditional Diffusion Model","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2502.09533","snapshot_observed_at":"2026-08-06T21:49:43.068047Z","title":"Preprint at urlhttps://arxiv.org/abs/2502.09533 (2025)","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2506.23295","last_updated":"2025-06-29T15:31:42Z","snapshot_observed_at":"2026-08-07T22:10:25.094459Z","submitted_at":"2025-06-29T15:31:42Z","title":"DiffFit: Disentangled Garment Warping and Texture Refinement for Virtual Try-On","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-06T21:49:43.068047Z"},"links":{"cited_paper":"/paper/2502.09533","citing_paper":"/paper/2506.23295"},"observation_digest":"sha256:99d36a8e404e37f9e4701906773b991b4ee1208e6f5949bad1523213168658f3","observation_id":"f41d0007-3832-408b-aa90-176c99afa492","resolution":{"observed_at":"2026-08-06T21:49:43.068047Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2502.09533","last_updated":"2025-02-13T17:50:23Z","snapshot_observed_at":"2026-08-07T22:10:29.240376Z","submitted_at":"2025-02-13T17:50:23Z","title":"Long-Term TalkingFace Generation via Motion-Prior Conditional Diffusion Model","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2502.09533","snapshot_observed_at":"2026-08-06T16:32:42.852220Z","title":"Long-term talkingface generation via motion-prior conditional diffusion model","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2507.13311","last_updated":"2026-08-06T06:13:15Z","snapshot_observed_at":"2026-08-09T05:09:19.039912Z","submitted_at":"2025-07-17T17:30:29Z","title":"FashionPose: Unified Text-Driven Fashion Synthesis with Joint Geometric and Photometric Control","version":1},"reference_index":60,"source":"pdf_text","source_observed_at":"2026-08-06T16:32:42.852220Z"},"links":{"cited_paper":"/paper/2502.09533","citing_paper":"/paper/2507.13311"},"observation_digest":"sha256:750d2cfa43f1dec524b56d6c7246c03f4f6e288bdc47973904e8890559e9c1b6","observation_id":"935487ee-fa4c-4c56-be1f-9a417bb65bae","resolution":{"observed_at":"2026-08-06T16:32:42.852220Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2502.09533","last_updated":"2025-02-13T17:50:23Z","snapshot_observed_at":"2026-08-07T22:10:29.240376Z","submitted_at":"2025-02-13T17:50:23Z","title":"Long-Term TalkingFace Generation via Motion-Prior Conditional Diffusion Model","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2502.09533","snapshot_observed_at":"2026-08-06T05:16:39.198335Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2508.02042","last_updated":"2025-08-04T04:21:38Z","snapshot_observed_at":"2026-08-07T21:34:07.582417Z","submitted_at":"2025-08-04T04:21:38Z","title":"Hybrid Compact Least-Squares and Central Weighted Essentially Non-Oscillatory Schemes for Hyperbolic Conservation Laws on Structured Curvilinear Grids","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-06T05:16:39.198335Z"},"links":{"cited_paper":"/paper/2502.09533","citing_paper":"/paper/2508.02042"},"observation_digest":"sha256:244e07d256e134a64c0ab955a6c068fd520f42e8676d40e1895d16368799c82c","observation_id":"6dde40ee-5261-4f9a-bb27-6242fc3ddc4b","resolution":{"observed_at":"2026-08-06T05:16:39.198335Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2502.09533","last_updated":"2025-02-13T17:50:23Z","snapshot_observed_at":"2026-08-07T22:10:29.240376Z","submitted_at":"2025-02-13T17:50:23Z","title":"Long-Term TalkingFace Generation via Motion-Prior Conditional Diffusion Model","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2502.09533","snapshot_observed_at":"2026-08-05T20:32:33.952580Z","title":"Long-term talkingface generation via motion-prior conditional diffusion model,","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2508.10397","last_updated":"2025-08-14T06:54:28Z","snapshot_observed_at":"2026-08-08T18:05:38.331524Z","submitted_at":"2025-08-14T06:54:28Z","title":"PQ-DAF: Pose-driven Quality-controlled Data Augmentation for Data-scarce Driver Distraction Detection","version":1},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-05T20:32:33.952580Z"},"links":{"cited_paper":"/paper/2502.09533","citing_paper":"/paper/2508.10397"},"observation_digest":"sha256:0c2df182aad5d2f331d8ac75248ec5671c5fa3844c3cfdf9f113d357f9e36602","observation_id":"57469f6a-51d2-4d6a-8690-a1ea624ad195","resolution":{"observed_at":"2026-08-05T20:32:33.952580Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2502.09533","last_updated":"2025-02-13T17:50:23Z","snapshot_observed_at":"2026-08-07T22:10:29.240376Z","submitted_at":"2025-02-13T17:50:23Z","title":"Long-Term TalkingFace Generation via Motion-Prior Conditional Diffusion Model","version":1},"cited_work":{"arxiv_id":"2502.09533","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2502.09533","snapshot_observed_at":"2026-07-01T22:16:15.690225Z","title":"Long-term talkingface gen- eration via motion-prior conditional diffusion model","venue":null,"work_id":"096bd3ff-2023-42b5-839c-74263d2851d1","year":2025},"citing_paper":{"arxiv_id":"2509.16702","last_updated":"2026-04-27T07:06:51Z","snapshot_observed_at":"2026-08-02T09:03:27.739361Z","submitted_at":"2025-09-20T14:09:48Z","title":"Animalbooth: multimodal feature enhancement for animal subject personalization","version":2},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-05-18T15:08:36.365653Z"},"links":{"cited_paper":"/paper/2502.09533","citing_paper":"/paper/2509.16702"},"observation_digest":"sha256:1fcd4c94b9afc024becb55d02e8d07dee73bac97a7ae149da194f0e5f3c298c4","observation_id":"7b6686c5-1bcd-4e34-8a20-1e769c76e7a9","resolution":{"observed_at":"2026-05-18T15:11:32.510809Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2502.09533","last_updated":"2025-02-13T17:50:23Z","snapshot_observed_at":"2026-08-07T22:10:29.240376Z","submitted_at":"2025-02-13T17:50:23Z","title":"Long-Term TalkingFace Generation via Motion-Prior Conditional Diffusion Model","version":1},"cited_work":{"arxiv_id":"2502.09533","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2502.09533","snapshot_observed_at":"2026-07-01T22:16:15.690225Z","title":"Long-term talkingface gen- eration via motion-prior conditional diffusion model","venue":null,"work_id":"096bd3ff-2023-42b5-839c-74263d2851d1","year":2025},"citing_paper":{"arxiv_id":"2604.17051","last_updated":"2026-04-18T16:13:49Z","snapshot_observed_at":"2026-07-06T23:04:14.688737Z","submitted_at":"2026-04-18T16:13:49Z","title":"Efficient Task Adaptation in Large Language Models via Selective Parameter Optimization","version":1},"reference_index":54,"source":"pdf_text","source_observed_at":"2026-05-10T06:21:59.735341Z"},"links":{"cited_paper":"/paper/2502.09533","citing_paper":"/paper/2604.17051"},"observation_digest":"sha256:119db9c92f0afbf88db4305ca6e414c8f808f515695fd432ba43a789fa35c441","observation_id":"ee20695c-b5c5-45f5-a1e2-db753e2ee630","resolution":{"observed_at":"2026-05-10T06:26:27.725653Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2502.09533","last_updated":"2025-02-13T17:50:23Z","snapshot_observed_at":"2026-08-07T22:10:29.240376Z","submitted_at":"2025-02-13T17:50:23Z","title":"Long-Term TalkingFace Generation via Motion-Prior Conditional Diffusion Model","version":1},"cited_work":{"arxiv_id":"2502.09533","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2502.09533","snapshot_observed_at":"2026-07-01T22:16:15.690225Z","title":"Long-term talkingface gen- eration via motion-prior conditional diffusion model","venue":null,"work_id":"096bd3ff-2023-42b5-839c-74263d2851d1","year":2025},"citing_paper":{"arxiv_id":"2606.02042","last_updated":"2026-06-01T10:30:42Z","snapshot_observed_at":"2026-08-02T00:31:53.110940Z","submitted_at":"2026-06-01T10:30:42Z","title":"Normality-Preserving Continual Industrial Anomaly Detection via Orthogonal LoRA Banks","version":1},"reference_index":42,"source":"pdf_text","source_observed_at":"2026-06-28T15:39:42.265865Z"},"links":{"cited_paper":"/paper/2502.09533","citing_paper":"/paper/2606.02042"},"observation_digest":"sha256:e3053f6af8372c451d052f6a12c383b333b57b2eb3ab5d81275c0eea0ffd1236","observation_id":"1aee91e6-4ba8-4dba-a8fa-cf65583cbfcf","resolution":{"observed_at":"2026-07-01T22:16:15.691775Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2502.09533","last_updated":"2025-02-13T17:50:23Z","snapshot_observed_at":"2026-08-07T22:10:29.240376Z","submitted_at":"2025-02-13T17:50:23Z","title":"Long-Term TalkingFace Generation via Motion-Prior Conditional Diffusion Model","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2502.09533","snapshot_observed_at":"2026-08-04T01:03:10.933501Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2608.00663","last_updated":"2026-08-01T13:33:38Z","snapshot_observed_at":"2026-08-06T23:17:35.817309Z","submitted_at":"2026-08-01T13:33:38Z","title":"Geometry-guided Emotion Modulation for Controllable and Photorealistic Emotional Talking Face Generation","version":1},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-08-04T01:03:10.933501Z"},"links":{"cited_paper":"/paper/2502.09533","citing_paper":"/paper/2608.00663"},"observation_digest":"sha256:65805686c1880c9e69c7d5dfd5498622f37102f0fd0329fb89d586873effe99a","observation_id":"36f6622d-bf09-41e2-b321-0a4dd7fb5434","resolution":{"observed_at":"2026-08-04T01:03:10.933501Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"links":{"evidence":"/evidence","html":"/paper/2502.09533/citation-record","integrity":"/paper/2502.09533/integrity","json":"/paper/2502.09533/citation-record.json","paper":"/paper/2502.09533"},"outbound":[{"citation":{"cited_paper":{"arxiv_id":"2307.04725","last_updated":"2024-02-08T18:08:57Z","snapshot_observed_at":"2026-07-06T15:52:13.602170Z","submitted_at":"2023-07-10T17:34:16Z","title":"AnimateDiff: Animate Your Personalized Text-to-Image Diffusion Models without Specific Tuning","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2307.04725","snapshot_observed_at":"2026-08-07T21:11:25.291921Z","title":"Animatediff: Animate your personalized text-to-image diffusion models without specific tuning","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2502.09533","last_updated":"2025-02-13T17:50:23Z","snapshot_observed_at":"2026-08-07T22:10:29.240376Z","submitted_at":"2025-02-13T17:50:23Z","title":"Long-Term TalkingFace Generation via Motion-Prior Conditional Diffusion Model","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-07T21:11:25.291921Z"},"links":{"cited_paper":"/paper/2307.04725","citing_paper":"/paper/2502.09533"},"observation_digest":"sha256:37ffe613fa90e126072366a18920aef6ff1e3f0012d692f9d0ea1804c5eacff5","observation_id":"57cf259c-8c50-4102-b798-303fcb71b2e2","resolution":{"observed_at":"2026-08-07T21:11:25.291921Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2409.02634","last_updated":"2025-04-04T05:13:40Z","snapshot_observed_at":"2026-08-05T07:44:02.175955Z","submitted_at":"2024-09-04T11:55:14Z","title":"Loopy: Taming Audio-Driven Portrait Avatar with Long-Term Motion Dependency","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2409.02634","snapshot_observed_at":"2026-08-07T21:11:25.297338Z","title":"Loopy: Taming audio-driven portrait avatar with long-term motion dependency","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2502.09533","last_updated":"2025-02-13T17:50:23Z","snapshot_observed_at":"2026-08-07T22:10:29.240376Z","submitted_at":"2025-02-13T17:50:23Z","title":"Long-Term TalkingFace Generation via Motion-Prior Conditional Diffusion Model","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-07T21:11:25.297338Z"},"links":{"cited_paper":"/paper/2409.02634","citing_paper":"/paper/2502.09533"},"observation_digest":"sha256:1507fa9495a924362f5870e9bc7ed5a541bce467b630741488ac47bec24af9b8","observation_id":"474d90ea-2f89-43c4-bdbc-6378b95be8b4","resolution":{"observed_at":"2026-08-07T21:11:25.297338Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2406.01900","last_updated":"2024-06-07T02:57:36Z","snapshot_observed_at":"2026-08-07T23:04:56.801786Z","submitted_at":"2024-06-04T02:05:57Z","title":"Follow-Your-Emoji: Fine-Controllable and Expressive Freestyle Portrait Animation","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2406.01900","snapshot_observed_at":"2026-08-07T21:11:25.308281Z","title":"Follow-your- emoji: Fine-controllable and expressive freestyle portrait animation","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2502.09533","last_updated":"2025-02-13T17:50:23Z","snapshot_observed_at":"2026-08-07T22:10:29.240376Z","submitted_at":"2025-02-13T17:50:23Z","title":"Long-Term TalkingFace Generation via Motion-Prior Conditional Diffusion Model","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-07T21:11:25.308281Z"},"links":{"cited_paper":"/paper/2406.01900","citing_paper":"/paper/2502.09533"},"observation_digest":"sha256:0f1a561b3bac1add34dbd5cbadafe9846a806a09ad1bab1cbb9779a98f37eb70","observation_id":"98ddb700-e5ef-44c9-8238-707a5776ae3d","resolution":{"observed_at":"2026-08-07T21:11:25.308281Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1411.1784","last_updated":"2014-11-06T22:33:22Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2014-11-06T22:33:22Z","title":"Conditional Generative Adversarial Nets","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1411.1784","snapshot_observed_at":"2026-08-07T21:11:25.316481Z","title":"and Osindero, S","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2502.09533","last_updated":"2025-02-13T17:50:23Z","snapshot_observed_at":"2026-08-07T22:10:29.240376Z","submitted_at":"2025-02-13T17:50:23Z","title":"Long-Term TalkingFace Generation via Motion-Prior Conditional Diffusion Model","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-07T21:11:25.316481Z"},"links":{"cited_paper":"/paper/1411.1784","citing_paper":"/paper/2502.09533"},"observation_digest":"sha256:9ace93f16673eabbde3c5e4e95b465059a280d0b5aebe701703fddc71b705280","observation_id":"72ffaecf-e325-4a00-8ab1-d3b02f04bb5c","resolution":{"observed_at":"2026-08-07T21:11:25.316481Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2312.01841","last_updated":"2023-12-07T03:14:22Z","snapshot_observed_at":"2026-07-30T10:55:21.867087Z","submitted_at":"2023-12-04T12:25:37Z","title":"VividTalk: One-Shot Audio-Driven Talking Head Generation Based on 3D Hybrid Prior","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2312.01841","snapshot_observed_at":"2026-08-07T21:11:25.321228Z","title":"Vividtalk: One- shot audio-driven talking head generation based on 3d hybrid prior","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2502.09533","last_updated":"2025-02-13T17:50:23Z","snapshot_observed_at":"2026-08-07T22:10:29.240376Z","submitted_at":"2025-02-13T17:50:23Z","title":"Long-Term TalkingFace Generation via Motion-Prior Conditional Diffusion Model","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-07T21:11:25.321228Z"},"links":{"cited_paper":"/paper/2312.01841","citing_paper":"/paper/2502.09533"},"observation_digest":"sha256:3e9d9cf96ef45c87795fe29d33237e9fd9ac2802624a67dae9440f8696784f18","observation_id":"d755df50-fff0-4158-a081-9ecf3c07e546","resolution":{"observed_at":"2026-08-07T21:11:25.321228Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2402.17485","last_updated":"2024-08-08T03:48:38Z","snapshot_observed_at":"2026-07-06T17:36:11.854303Z","submitted_at":"2024-02-27T13:10:11Z","title":"EMO: Emote Portrait Alive -- Generating Expressive Portrait Videos with Audio2Video Diffusion Model under Weak Conditions","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.17485","snapshot_observed_at":"2026-08-07T21:11:25.326761Z","title":"Emo: Emote por- trait alive-generating expressive portrait videos with au- dio2video diffusion model under weak conditions","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2502.09533","last_updated":"2025-02-13T17:50:23Z","snapshot_observed_at":"2026-08-07T22:10:29.240376Z","submitted_at":"2025-02-13T17:50:23Z","title":"Long-Term TalkingFace Generation via Motion-Prior Conditional Diffusion Model","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-07T21:11:25.326761Z"},"links":{"cited_paper":"/paper/2402.17485","citing_paper":"/paper/2502.09533"},"observation_digest":"sha256:3f3fc34c1825a97aca31a75e74a2c3701117e94f9265bb203b724334ecb67b12","observation_id":"36200a4b-9d05-4474-a700-c0f8f9df36b6","resolution":{"observed_at":"2026-08-07T21:11:25.326761Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2406.02511","last_updated":"2024-06-04T17:32:52Z","snapshot_observed_at":"2026-07-06T18:25:18.469656Z","submitted_at":"2024-06-04T17:32:52Z","title":"V-Express: Conditional Dropout for Progressive Training of Portrait Video Generation","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2406.02511","snapshot_observed_at":"2026-08-07T21:11:25.331488Z","title":"V-express: Con- ditional dropout for progressive training of portrait video generation","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2502.09533","last_updated":"2025-02-13T17:50:23Z","snapshot_observed_at":"2026-08-07T22:10:29.240376Z","submitted_at":"2025-02-13T17:50:23Z","title":"Long-Term TalkingFace Generation via Motion-Prior Conditional Diffusion Model","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-07T21:11:25.331488Z"},"links":{"cited_paper":"/paper/2406.02511","citing_paper":"/paper/2502.09533"},"observation_digest":"sha256:445016f4ab6f66e14d773528cea49ec617927d8c976dd66f1b63144610601a8a","observation_id":"097ae7fe-22e1-4922-9e50-080a7471ffe1","resolution":{"observed_at":"2026-08-07T21:11:25.331488Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2107.09293","last_updated":"2021-07-20T07:22:42Z","snapshot_observed_at":"2026-08-08T20:10:22.042475Z","submitted_at":"2021-07-20T07:22:42Z","title":"Audio2Head: Audio-driven One-shot Talking-head Generation with Natural Head Motion","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2107.09293","snapshot_observed_at":"2026-08-07T21:11:25.336787Z","title":"Audio2head: Audio-driven one-shot talking-head generation with nat- ural head motion","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2502.09533","last_updated":"2025-02-13T17:50:23Z","snapshot_observed_at":"2026-08-07T22:10:29.240376Z","submitted_at":"2025-02-13T17:50:23Z","title":"Long-Term TalkingFace Generation via Motion-Prior Conditional Diffusion Model","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-07T21:11:25.336787Z"},"links":{"cited_paper":"/paper/2107.09293","citing_paper":"/paper/2502.09533"},"observation_digest":"sha256:75f2f1eccb9812561de0e7554015cbcfd24163346caa3990d8c95ccd37da745e","observation_id":"4990ae01-00a6-440d-94d2-4aee3b75ffcb","resolution":{"observed_at":"2026-08-07T21:11:25.336787Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2406.08801","last_updated":"2024-06-16T07:10:41Z","snapshot_observed_at":"2026-07-06T18:30:06.570612Z","submitted_at":"2024-06-13T04:33:20Z","title":"Hallo: Hierarchical Audio-Driven Visual Synthesis for Portrait Image Animation","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2406.08801","snapshot_observed_at":"2026-08-07T21:11:25.346813Z","title":"Hallo: Hierarchical audio-driven visual synthesis for portrait image animation","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2502.09533","last_updated":"2025-02-13T17:50:23Z","snapshot_observed_at":"2026-08-07T22:10:29.240376Z","submitted_at":"2025-02-13T17:50:23Z","title":"Long-Term TalkingFace Generation via Motion-Prior Conditional Diffusion Model","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-07T21:11:25.346813Z"},"links":{"cited_paper":"/paper/2406.08801","citing_paper":"/paper/2502.09533"},"observation_digest":"sha256:c117251b8417faddfc020bf71a94aa4e205349ae4b4da060d8bbdc0618b965f3","observation_id":"782611a5-f612-4cd7-9bab-0569d37f67e8","resolution":{"observed_at":"2026-08-07T21:11:25.346813Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2408.14975","last_updated":"2024-08-27T11:31:47Z","snapshot_observed_at":"2026-07-06T19:06:33.176704Z","submitted_at":"2024-08-27T11:31:47Z","title":"MegActor-$\\Sigma$: Unlocking Flexible Mixed-Modal Control in Portrait Animation with Diffusion Transformer","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2408.14975","snapshot_observed_at":"2026-08-07T21:11:25.351778Z","title":"Megactor-sigma: Unlocking flexible mixed-modal control in portrait animation with diffusion transformer","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2502.09533","last_updated":"2025-02-13T17:50:23Z","snapshot_observed_at":"2026-08-07T22:10:29.240376Z","submitted_at":"2025-02-13T17:50:23Z","title":"Long-Term TalkingFace Generation via Motion-Prior Conditional Diffusion Model","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-07T21:11:25.351778Z"},"links":{"cited_paper":"/paper/2408.14975","citing_paper":"/paper/2502.09533"},"observation_digest":"sha256:2260d1c7aee4275101f5d7dd6b310cc58df7afebbf1764960a77cbe2fa50829d","observation_id":"6d4c7959-1304-4c60-8db9-36dbb3781a89","resolution":{"observed_at":"2026-08-07T21:11:25.351778Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2401.08503","last_updated":"2024-03-23T06:40:22Z","snapshot_observed_at":"2026-08-09T00:31:41.576534Z","submitted_at":"2024-01-16T17:04:30Z","title":"Real3D-Portrait: One-shot Realistic 3D Talking Portrait Synthesis","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2401.08503","snapshot_observed_at":"2026-08-07T21:11:25.361857Z","title":"Real3d-portrait: One- shot realistic 3d talking portrait synthesis","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2502.09533","last_updated":"2025-02-13T17:50:23Z","snapshot_observed_at":"2026-08-07T22:10:29.240376Z","submitted_at":"2025-02-13T17:50:23Z","title":"Long-Term TalkingFace Generation via Motion-Prior Conditional Diffusion Model","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-07T21:11:25.361857Z"},"links":{"cited_paper":"/paper/2401.08503","citing_paper":"/paper/2502.09533"},"observation_digest":"sha256:3648b242e5e0ab457fa179798ee17b4cdd958acaa90baad08b4e5c0494a1a568","observation_id":"5db63e4b-d91b-4a58-bf14-6fb7cdffda11","resolution":{"observed_at":"2026-08-07T21:11:25.361857Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2403.17694","last_updated":"2024-03-26T13:35:02Z","snapshot_observed_at":"2026-08-07T20:48:39.175359Z","submitted_at":"2024-03-26T13:35:02Z","title":"AniPortrait: Audio-Driven Synthesis of Photorealistic Portrait Animation","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2403.17694","snapshot_observed_at":"2026-08-07T21:11:25.341871Z","title":"Aniportrait: Audio-driven synthesis of photorealistic portrait animation","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2502.09533","last_updated":"2025-02-13T17:50:23Z","snapshot_observed_at":"2026-08-07T22:10:29.240376Z","submitted_at":"2025-02-13T17:50:23Z","title":"Long-Term TalkingFace Generation via Motion-Prior Conditional Diffusion Model","version":1},"reference_index":2004,"source":"pdf_text","source_observed_at":"2026-08-07T21:11:25.341871Z"},"links":{"cited_paper":"/paper/2403.17694","citing_paper":"/paper/2502.09533"},"observation_digest":"sha256:88afa82781ea52944915c7897145abc6396993da535dc774a0246a090b03067c","observation_id":"88ec1c50-ff40-442b-8334-1dada8c4bcc6","resolution":{"observed_at":"2026-08-07T21:11:25.341871Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2105.04714","last_updated":"2021-05-10T23:51:14Z","snapshot_observed_at":"2026-07-06T11:08:10.746485Z","submitted_at":"2021-05-10T23:51:14Z","title":"Sample and Computation Redistribution for Efficient Face Detection","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2105.04714","snapshot_observed_at":"2026-08-07T21:11:25.281084Z","title":"Sample and computation redistribution for efficient face detection","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2502.09533","last_updated":"2025-02-13T17:50:23Z","snapshot_observed_at":"2026-08-07T22:10:29.240376Z","submitted_at":"2025-02-13T17:50:23Z","title":"Long-Term TalkingFace Generation via Motion-Prior Conditional Diffusion Model","version":1},"reference_index":2014,"source":"pdf_text","source_observed_at":"2026-08-07T21:11:25.281084Z"},"links":{"cited_paper":"/paper/2105.04714","citing_paper":"/paper/2502.09533"},"observation_digest":"sha256:66a4187423364273141935fb88db2d46c49ca473a95c4c933dfb9c6119266787","observation_id":"a92da7ae-1faa-4da0-9dab-3ab6c1037d16","resolution":{"observed_at":"2026-08-07T21:11:25.281084Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T21:11:25.674981Z","title":"Crafting papers on machine learning","venue":null,"work_id":"f440d744-d22a-4ec9-a6bc-055c488df582","year":2000},"citing_paper":{"arxiv_id":"2502.09533","last_updated":"2025-02-13T17:50:23Z","snapshot_observed_at":"2026-08-07T22:10:29.240376Z","submitted_at":"2025-02-13T17:50:23Z","title":"Long-Term TalkingFace Generation via Motion-Prior Conditional Diffusion Model","version":1},"reference_index":2018,"source":"pdf_text","source_observed_at":"2026-08-07T21:11:25.303427Z"},"links":{"citing_paper":"/paper/2502.09533"},"observation_digest":"sha256:efdc7fb4401e47d235d10f84e73068d49eca0d144bfa6fc3531fb961e7ebf1a3","observation_id":"384ec42d-aed8-4d3b-a537-0441ea9305df","resolution":{"observed_at":"2026-08-07T21:11:25.682055Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T21:11:25.693500Z","title":null,"venue":null,"work_id":"0e324dc3-b449-4f25-b4e5-45587df24331","year":2016},"citing_paper":{"arxiv_id":"2502.09533","last_updated":"2025-02-13T17:50:23Z","snapshot_observed_at":"2026-08-07T22:10:29.240376Z","submitted_at":"2025-02-13T17:50:23Z","title":"Long-Term TalkingFace Generation via Motion-Prior Conditional Diffusion Model","version":1},"reference_index":2020,"source":"pdf_text","source_observed_at":"2026-08-07T21:11:25.275638Z"},"links":{"citing_paper":"/paper/2502.09533"},"observation_digest":"sha256:659fd866e43f1ba342545fadce4cae581f8f73f6329d6c24cc4bd990b8ea6401","observation_id":"abb3ad0d-a995-4cdb-a115-e72864834e07","resolution":{"observed_at":"2026-08-07T21:11:25.698341Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2407.03168","last_updated":"2025-02-28T14:39:17Z","snapshot_observed_at":"2026-08-08T10:55:01.205999Z","submitted_at":"2024-07-03T14:41:39Z","title":"LivePortrait: Efficient Portrait Animation with Stitching and Retargeting Control","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2407.03168","snapshot_observed_at":"2026-08-07T21:11:25.286501Z","title":"Liveportrait: Efficient portrait animation with stitching and retargeting control","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2502.09533","last_updated":"2025-02-13T17:50:23Z","snapshot_observed_at":"2026-08-07T22:10:29.240376Z","submitted_at":"2025-02-13T17:50:23Z","title":"Long-Term TalkingFace Generation via Motion-Prior Conditional Diffusion Model","version":1},"reference_index":2021,"source":"pdf_text","source_observed_at":"2026-08-07T21:11:25.286501Z"},"links":{"cited_paper":"/paper/2407.03168","citing_paper":"/paper/2502.09533"},"observation_digest":"sha256:8dbdcbe645dd75f2a442a83947b5f54d11a054e6ee11d5b1f120db9bedf9557d","observation_id":"08bf05cc-281b-42ca-aac5-b392396fcb09","resolution":{"observed_at":"2026-08-07T21:11:25.286501Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2407.08136","last_updated":"2024-07-12T02:41:51Z","snapshot_observed_at":"2026-08-05T23:17:13.069591Z","submitted_at":"2024-07-11T02:26:51Z","title":"EchoMimic: Lifelike Audio-Driven Portrait Animations through Editable Landmark Conditions","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2407.08136","snapshot_observed_at":"2026-08-07T21:11:25.264649Z","title":"Echomimic: Lifelike audio-driven portrait animations through editable landmark conditions","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2502.09533","last_updated":"2025-02-13T17:50:23Z","snapshot_observed_at":"2026-08-07T22:10:29.240376Z","submitted_at":"2025-02-13T17:50:23Z","title":"Long-Term TalkingFace Generation via Motion-Prior Conditional Diffusion Model","version":1},"reference_index":2022,"source":"pdf_text","source_observed_at":"2026-08-07T21:11:25.264649Z"},"links":{"cited_paper":"/paper/2407.08136","citing_paper":"/paper/2502.09533"},"observation_digest":"sha256:c1d336a5651879f661ac0bb199a666488867bc2166774ab99258845e8491b565","observation_id":"bd35958b-9046-4297-a994-217df4ce15b3","resolution":{"observed_at":"2026-08-07T21:11:25.264649Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2301.13430","last_updated":"2023-01-31T05:56:06Z","snapshot_observed_at":"2026-07-06T14:46:26.697969Z","submitted_at":"2023-01-31T05:56:06Z","title":"GeneFace: Generalized and High-Fidelity Audio-Driven 3D Talking Face Synthesis","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2301.13430","snapshot_observed_at":"2026-08-07T21:11:25.356730Z","title":"Geneface: Generalized and high-fidelity audio-driven 3d talking face synthesis","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2502.09533","last_updated":"2025-02-13T17:50:23Z","snapshot_observed_at":"2026-08-07T22:10:29.240376Z","submitted_at":"2025-02-13T17:50:23Z","title":"Long-Term TalkingFace Generation via Motion-Prior Conditional Diffusion Model","version":1},"reference_index":2023,"source":"pdf_text","source_observed_at":"2026-08-07T21:11:25.356730Z"},"links":{"cited_paper":"/paper/2301.13430","citing_paper":"/paper/2502.09533"},"observation_digest":"sha256:162675812b168e094089dbc63932d51d57072c47ed44e2dcc9540d3bbfdc6f88","observation_id":"746a755d-ddee-4651-8d08-d40846e57a4b","resolution":{"observed_at":"2026-08-07T21:11:25.356730Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2009.14794","last_updated":"2022-11-19T12:45:21Z","snapshot_observed_at":"2026-08-08T20:36:21.234658Z","submitted_at":"2020-09-30T17:09:09Z","title":"Rethinking Attention with Performers","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2009.14794","snapshot_observed_at":"2026-08-07T21:11:25.270249Z","title":"Rethinking attention with performers","venue":null,"work_id":null,"year":2009},"citing_paper":{"arxiv_id":"2502.09533","last_updated":"2025-02-13T17:50:23Z","snapshot_observed_at":"2026-08-07T22:10:29.240376Z","submitted_at":"2025-02-13T17:50:23Z","title":"Long-Term TalkingFace Generation via Motion-Prior Conditional Diffusion Model","version":1},"reference_index":2024,"source":"pdf_text","source_observed_at":"2026-08-07T21:11:25.270249Z"},"links":{"cited_paper":"/paper/2009.14794","citing_paper":"/paper/2502.09533"},"observation_digest":"sha256:94d5879959975db3d326cbd56ec0e3aad4ace6d0e9d65fda7eea4ba4e83cacaf","observation_id":"dd4f1530-c095-4f30-be55-3ea48c51dd61","resolution":{"observed_at":"2026-08-07T21:11:25.270249Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"paper":{"arxiv_id":"2502.09533","last_updated":"2025-02-13T17:50:23Z","latest_version":1,"primary_category":"cs.CV","snapshot_observed_at":"2026-08-07T22:10:29.240376Z","submitted_at":"2025-02-13T17:50:23Z","title":"Long-Term TalkingFace Generation via Motion-Prior Conditional Diffusion Model"},"reference_resolution":{"displayed":19,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":18,"verified_exact":0,"verified_fuzzy":1},"total_outbound_references":19},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"thesis":"As of 9 August 2026, this Paper Citation Record lists 19 of 19 outbound references and 16 inbound Pith citation observations for arXiv:2502.09533."}