{"as_of":"2026-08-09T09:20:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:a8bc712019a83db118b91769cd73d57e3253445e5740963ea2ad4311a6931bad","coverage":[{"denominator":0,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":21,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":21,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-09T06:31:02.800959+00:00","state":"measured"},{"denominator":21,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":21,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-08T20:49:51.506385Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"arxiv_reference","source_observed_at":"2026-07-01T21:46:15.567696Z","state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2312.09767","last_updated":"2024-08-10T09:37:55Z","snapshot_observed_at":"2026-07-06T17:02:37.841641Z","submitted_at":"2023-12-15T13:15:42Z","title":"DreamTalk: When Emotional Talking Head Generation Meets Diffusion Probabilistic Models","version":3},"cited_work":{"arxiv_id":"2312.09767","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2312.09767","snapshot_observed_at":"2026-07-01T21:46:15.567696Z","title":"DreamTalk: When Emotional Talking Head Generation Meets Diffusion Probabilistic Models","venue":null,"work_id":"4352eabd-8ef9-4a9b-aecb-611a81401210","year":2023},"citing_paper":{"arxiv_id":"2411.09209","last_updated":"2026-04-16T07:45:17Z","snapshot_observed_at":"2026-08-07T12:05:21.397143Z","submitted_at":"2024-11-14T06:13:05Z","title":"JoyVASA: Portrait and Animal Image Animation with Diffusion-Based Audio-Driven Facial Dynamics and Head Motion Generation","version":5},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-05-23T16:59:57.727035Z"},"links":{"cited_paper":"/paper/2312.09767","citing_paper":"/paper/2411.09209"},"observation_digest":"sha256:ff2507040eaf46af33c1b1701d6da1449291f6e85e585580b49cc186bdd25600","observation_id":"59433fa3-7ab4-4237-965d-87ed000e5eda","resolution":{"observed_at":"2026-05-23T17:03:12.563841Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2312.09767","last_updated":"2024-08-10T09:37:55Z","snapshot_observed_at":"2026-07-06T17:02:37.841641Z","submitted_at":"2023-12-15T13:15:42Z","title":"DreamTalk: When Emotional Talking Head Generation Meets Diffusion Probabilistic Models","version":3},"cited_work":{"arxiv_id":"2312.09767","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2312.09767","snapshot_observed_at":"2026-07-01T21:46:15.567696Z","title":"DreamTalk: When Emotional Talking Head Generation Meets Diffusion Probabilistic Models","venue":null,"work_id":"4352eabd-8ef9-4a9b-aecb-611a81401210","year":2023},"citing_paper":{"arxiv_id":"2411.16748","last_updated":"2026-05-08T09:16:59Z","snapshot_observed_at":"2026-08-04T02:06:42.093429Z","submitted_at":"2024-11-24T04:46:00Z","title":"Multimodal Diffusion Transformer with Memory Bank for Scalable Long-Duration Talking Video Generation","version":5},"reference_index":36,"source":"pdf_text","source_observed_at":"2026-05-23T17:19:51.411937Z"},"links":{"cited_paper":"/paper/2312.09767","citing_paper":"/paper/2411.16748"},"observation_digest":"sha256:1fd37c155841cb8d36eaf49c182991406fc04d487fe41c806b11dbd9c993f375","observation_id":"e4c76726-3be6-4ffe-b96a-2c3f4646ce14","resolution":{"observed_at":"2026-05-23T17:23:15.345266Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2312.09767","last_updated":"2024-08-10T09:37:55Z","snapshot_observed_at":"2026-07-06T17:02:37.841641Z","submitted_at":"2023-12-15T13:15:42Z","title":"DreamTalk: When Emotional Talking Head Generation Meets Diffusion Probabilistic Models","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2312.09767","snapshot_observed_at":"2026-08-08T20:49:51.506385Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2502.04976","last_updated":"2025-02-07T14:50:10Z","snapshot_observed_at":"2026-08-08T20:42:47.770955Z","submitted_at":"2025-02-07T14:50:10Z","title":"Towards Multimodal Empathetic Response Generation: A Rich Text-Speech-Vision Avatar-based Benchmark","version":1},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-08-08T20:49:51.506385Z"},"links":{"cited_paper":"/paper/2312.09767","citing_paper":"/paper/2502.04976"},"observation_digest":"sha256:e83b6afc894fa1df9da9c81e7e9bdda91e1641902177cd7c5518da9b37c4d661","observation_id":"ad011661-eb30-4f38-b868-0fa2e5831a66","resolution":{"observed_at":"2026-08-08T20:49:51.506385Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2312.09767","last_updated":"2024-08-10T09:37:55Z","snapshot_observed_at":"2026-07-06T17:02:37.841641Z","submitted_at":"2023-12-15T13:15:42Z","title":"DreamTalk: When Emotional Talking Head Generation Meets Diffusion Probabilistic Models","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2312.09767","snapshot_observed_at":"2026-08-07T12:01:07.552280Z","title":"Dreamtalk: When expressive talking head generation meets diffusion probabilistic models","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.00830","last_updated":"2025-06-01T04:27:13Z","snapshot_observed_at":"2026-08-07T20:51:49.766697Z","submitted_at":"2025-06-01T04:27:13Z","title":"SkyReels-Audio: Omni Audio-Conditioned Talking Portraits in Video Diffusion Transformers","version":1},"reference_index":45,"source":"pdf_text","source_observed_at":"2026-08-07T12:01:07.552280Z"},"links":{"cited_paper":"/paper/2312.09767","citing_paper":"/paper/2506.00830"},"observation_digest":"sha256:5bd74ff882772aabdb384ce915985e358eb4338a72258d1dc6cd6f479abd574d","observation_id":"5b524bad-e05e-4c5b-82cf-4f52c311a11b","resolution":{"observed_at":"2026-08-07T12:01:07.552280Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2312.09767","last_updated":"2024-08-10T09:37:55Z","snapshot_observed_at":"2026-07-06T17:02:37.841641Z","submitted_at":"2023-12-15T13:15:42Z","title":"DreamTalk: When Emotional Talking Head Generation Meets Diffusion Probabilistic Models","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2312.09767","snapshot_observed_at":"2026-08-07T11:20:49.010442Z","title":"Dreamtalk: When expressive talking head generation meets diffusion probabilistic models.arXiv preprint arXiv:2312.09767, 2023","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.02875","last_updated":"2025-06-03T13:39:57Z","snapshot_observed_at":"2026-08-07T21:50:37.234501Z","submitted_at":"2025-06-03T13:39:57Z","title":"NTIRE 2025 XGC Quality Assessment Challenge: Methods and Results","version":1},"reference_index":59,"source":"pdf_text","source_observed_at":"2026-08-07T11:20:49.010442Z"},"links":{"cited_paper":"/paper/2312.09767","citing_paper":"/paper/2506.02875"},"observation_digest":"sha256:721ea0238b66ca09f8db080442662497f017b31af77be9243a7585643c6d58d7","observation_id":"eb2b6f1b-38bf-4588-8e9e-3f1e80c56545","resolution":{"observed_at":"2026-08-07T11:20:49.010442Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2312.09767","last_updated":"2024-08-10T09:37:55Z","snapshot_observed_at":"2026-07-06T17:02:37.841641Z","submitted_at":"2023-12-15T13:15:42Z","title":"DreamTalk: When Emotional Talking Head Generation Meets Diffusion Probabilistic Models","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2312.09767","snapshot_observed_at":"2026-08-07T05:53:39.932611Z","title":"DreamTalk: When Expressive Talking Head Gener- ation Meets Diffusion Probabilistic Models","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.06825","last_updated":"2025-06-07T15:02:23Z","snapshot_observed_at":"2026-08-09T07:08:40.145158Z","submitted_at":"2025-06-07T15:02:23Z","title":"Identity Deepfake Threats to Biometric Authentication Systems: Public and Expert Perspectives","version":1},"reference_index":40,"source":"pdf_text","source_observed_at":"2026-08-07T05:53:39.932611Z"},"links":{"cited_paper":"/paper/2312.09767","citing_paper":"/paper/2506.06825"},"observation_digest":"sha256:4ce24d9fa9c7c58f0fc9c21ed2b09ea3ab96a0533e98376c7f50dcedfbf0b199","observation_id":"557aed13-f628-4c58-ba83-519d2bcb644d","resolution":{"observed_at":"2026-08-07T05:53:39.932611Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2312.09767","last_updated":"2024-08-10T09:37:55Z","snapshot_observed_at":"2026-07-06T17:02:37.841641Z","submitted_at":"2023-12-15T13:15:42Z","title":"DreamTalk: When Emotional Talking Head Generation Meets Diffusion Probabilistic Models","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2312.09767","snapshot_observed_at":"2026-08-07T00:15:43.559742Z","title":"Dreamtalk: When expressive talking head generation meets diffusion probabilistic models,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.14742","last_updated":"2025-06-17T17:22:12Z","snapshot_observed_at":"2026-08-07T20:51:47.320894Z","submitted_at":"2025-06-17T17:22:12Z","title":"SyncTalk++: High-Fidelity and Efficient Synchronized Talking Heads Synthesis Using Gaussian Splatting","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-07T00:15:43.559742Z"},"links":{"cited_paper":"/paper/2312.09767","citing_paper":"/paper/2506.14742"},"observation_digest":"sha256:c32529413576ea4ae5a54287ea00401955aca246142c49d4764dbf27047d801f","observation_id":"95a99982-148d-4c3b-9696-7897732094f0","resolution":{"observed_at":"2026-08-07T00:15:43.559742Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2312.09767","last_updated":"2024-08-10T09:37:55Z","snapshot_observed_at":"2026-07-06T17:02:37.841641Z","submitted_at":"2023-12-15T13:15:42Z","title":"DreamTalk: When Emotional Talking Head Generation Meets Diffusion Probabilistic Models","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2312.09767","snapshot_observed_at":"2026-08-06T22:15:08.419865Z","title":"Dreamtalk: When emotional talking head generation meets diffusion probabilistic mod- els","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.22065","last_updated":"2025-06-27T09:57:23Z","snapshot_observed_at":"2026-08-08T07:14:46.514760Z","submitted_at":"2025-06-27T09:57:23Z","title":"MirrorMe: Towards Realtime and High Fidelity Audio-Driven Halfbody Animation","version":1},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-06T22:15:08.419865Z"},"links":{"cited_paper":"/paper/2312.09767","citing_paper":"/paper/2506.22065"},"observation_digest":"sha256:242e13b376cf9f291f1432af38923b8246ffa80975e6b037fc877a3e809d8432","observation_id":"914f27cf-23b6-424b-8de6-87d67fa033e7","resolution":{"observed_at":"2026-08-06T22:15:08.419865Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2312.09767","last_updated":"2024-08-10T09:37:55Z","snapshot_observed_at":"2026-07-06T17:02:37.841641Z","submitted_at":"2023-12-15T13:15:42Z","title":"DreamTalk: When Emotional Talking Head Generation Meets Diffusion Probabilistic Models","version":3},"cited_work":{"arxiv_id":"2312.09767","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2312.09767","snapshot_observed_at":"2026-07-01T21:46:15.567696Z","title":"DreamTalk: When Emotional Talking Head Generation Meets Diffusion Probabilistic Models","venue":null,"work_id":"4352eabd-8ef9-4a9b-aecb-611a81401210","year":2023},"citing_paper":{"arxiv_id":"2506.23552","last_updated":"2026-05-15T04:47:28Z","snapshot_observed_at":"2026-07-06T21:49:33.849898Z","submitted_at":"2025-06-30T06:51:40Z","title":"JAM-Flow: Joint Audio-Motion Synthesis with Flow Matching","version":2},"reference_index":41,"source":"pdf_text","source_observed_at":"2026-05-22T00:46:39.196042Z"},"links":{"cited_paper":"/paper/2312.09767","citing_paper":"/paper/2506.23552"},"observation_digest":"sha256:30fb9fda411d10b68d0b4005aa20bcbf2b74a8aee5c5fbcd7727828fbd6a3d31","observation_id":"f26d6c43-0e8a-4147-8eca-c43287443d6f","resolution":{"observed_at":"2026-05-22T00:50:51.035807Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2312.09767","last_updated":"2024-08-10T09:37:55Z","snapshot_observed_at":"2026-07-06T17:02:37.841641Z","submitted_at":"2023-12-15T13:15:42Z","title":"DreamTalk: When Emotional Talking Head Generation Meets Diffusion Probabilistic Models","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2312.09767","snapshot_observed_at":"2026-08-06T19:38:20.504641Z","title":"Dreamtalk: When expressive talking head generation meets diffusion probabilistic models","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2507.05092","last_updated":"2025-07-07T15:13:46Z","snapshot_observed_at":"2026-08-08T14:17:46.996950Z","submitted_at":"2025-07-07T15:13:46Z","title":"MoDiT: Learning Highly Consistent 3D Motion Coefficients with Diffusion Transformer for Talking Head Generation","version":1},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-08-06T19:38:20.504641Z"},"links":{"cited_paper":"/paper/2312.09767","citing_paper":"/paper/2507.05092"},"observation_digest":"sha256:9cdbc93214aab33e8ca2dc6d2bdbb188dbb2f9d15a910327e5cc9a8e05318750","observation_id":"3d446572-f400-4b64-92f0-d6db6a9cd57a","resolution":{"observed_at":"2026-08-06T19:38:20.504641Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2312.09767","last_updated":"2024-08-10T09:37:55Z","snapshot_observed_at":"2026-07-06T17:02:37.841641Z","submitted_at":"2023-12-15T13:15:42Z","title":"DreamTalk: When Emotional Talking Head Generation Meets Diffusion Probabilistic Models","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2312.09767","snapshot_observed_at":"2026-08-06T13:10:19.601406Z","title":"Dreamtalk: When ex- pressive talking head generation meets diffusion probabilis- tic models","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2507.20953","last_updated":"2025-07-28T16:03:36Z","snapshot_observed_at":"2026-08-09T07:29:24.015101Z","submitted_at":"2025-07-28T16:03:36Z","title":"Mask-Free Audio-driven Talking Face Generation for Enhanced Visual Quality and Identity Preservation","version":1},"reference_index":53,"source":"pdf_text","source_observed_at":"2026-08-06T13:10:19.601406Z"},"links":{"cited_paper":"/paper/2312.09767","citing_paper":"/paper/2507.20953"},"observation_digest":"sha256:b66de12f7864d307854eef2e58d6921fc7803428aa921f3b4bdfb0e039c81a53","observation_id":"288b8791-b9ae-48dd-b171-d59d1f9503f7","resolution":{"observed_at":"2026-08-06T13:10:19.601406Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2312.09767","last_updated":"2024-08-10T09:37:55Z","snapshot_observed_at":"2026-07-06T17:02:37.841641Z","submitted_at":"2023-12-15T13:15:42Z","title":"DreamTalk: When Emotional Talking Head Generation Meets Diffusion Probabilistic Models","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2312.09767","snapshot_observed_at":"2026-08-06T10:53:19.020094Z","title":"Dreamtalk: When expressive talking head generation meets diffusion probabilistic models","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2507.23343","last_updated":"2025-07-31T08:43:21Z","snapshot_observed_at":"2026-08-08T04:06:08.932242Z","submitted_at":"2025-07-31T08:43:21Z","title":"Who is a Better Talker: Subjective and Objective Quality Assessment for AI-Generated Talking Heads","version":1},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-06T10:53:19.020094Z"},"links":{"cited_paper":"/paper/2312.09767","citing_paper":"/paper/2507.23343"},"observation_digest":"sha256:06bae44618f9506fbf6112b1c77c0ec1aa85c86850a7cb1dc939056dca461620","observation_id":"f647508e-8349-4959-be72-5874be2655b4","resolution":{"observed_at":"2026-08-06T10:53:19.020094Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2312.09767","last_updated":"2024-08-10T09:37:55Z","snapshot_observed_at":"2026-07-06T17:02:37.841641Z","submitted_at":"2023-12-15T13:15:42Z","title":"DreamTalk: When Emotional Talking Head Generation Meets Diffusion Probabilistic Models","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2312.09767","snapshot_observed_at":"2026-08-05T20:06:48.133326Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2508.11255","last_updated":"2025-08-15T06:43:46Z","snapshot_observed_at":"2026-08-08T07:02:19.422958Z","submitted_at":"2025-08-15T06:43:46Z","title":"FantasyTalking2: Timestep-Layer Adaptive Preference Optimization for Audio-Driven Portrait Animation","version":1},"reference_index":40,"source":"arxiv_source","source_observed_at":"2026-08-05T20:06:48.133326Z"},"links":{"cited_paper":"/paper/2312.09767","citing_paper":"/paper/2508.11255"},"observation_digest":"sha256:e429f46624125b380c51a1b0446929e226e76c8b049c0935f77e9ed2e9a5160d","observation_id":"e3cc0341-9468-470c-8ff9-aba2f48ad25d","resolution":{"observed_at":"2026-08-05T20:06:48.133326Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2312.09767","last_updated":"2024-08-10T09:37:55Z","snapshot_observed_at":"2026-07-06T17:02:37.841641Z","submitted_at":"2023-12-15T13:15:42Z","title":"DreamTalk: When Emotional Talking Head Generation Meets Diffusion Probabilistic Models","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2312.09767","snapshot_observed_at":"2026-08-05T10:36:57.394438Z","title":"Dreamtalk: When expressive talking head generation meets diffusion probabilistic models,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2509.03883","last_updated":"2025-09-04T04:39:21Z","snapshot_observed_at":"2026-08-07T20:50:00.215211Z","submitted_at":"2025-09-04T04:39:21Z","title":"Human Motion Video Generation: A Survey","version":1},"reference_index":158,"source":"pdf_text","source_observed_at":"2026-08-05T10:36:57.394438Z"},"links":{"cited_paper":"/paper/2312.09767","citing_paper":"/paper/2509.03883"},"observation_digest":"sha256:d83fc07305966b9071771c6a84b35812e58b9aa6f2f8e92c3fe982e6aa6b9eab","observation_id":"0f2707a4-8eb6-4427-833a-5c65644253e0","resolution":{"observed_at":"2026-08-05T10:36:57.394438Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2312.09767","last_updated":"2024-08-10T09:37:55Z","snapshot_observed_at":"2026-07-06T17:02:37.841641Z","submitted_at":"2023-12-15T13:15:42Z","title":"DreamTalk: When Emotional Talking Head Generation Meets Diffusion Probabilistic Models","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2312.09767","snapshot_observed_at":"2026-08-04T11:06:48.586938Z","title":"DreamTalk: When Expressive Talking Head Generation Meets Diffusion Probabilistic Models,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2510.07355","last_updated":"2026-05-28T11:55:17Z","snapshot_observed_at":"2026-08-07T20:52:44.589895Z","submitted_at":"2025-10-08T14:13:28Z","title":"AV-EMO-Reasoning: Benchmarking Emotional Reasoning Capabilities in Omni-modal LLMS with Audio-visual Cues","version":2},"reference_index":42,"source":"pdf_text","source_observed_at":"2026-08-04T11:06:48.586938Z"},"links":{"cited_paper":"/paper/2312.09767","citing_paper":"/paper/2510.07355"},"observation_digest":"sha256:d26f962b8d4694fb8fa549f5495b250909bcfde076180767a21a3ecbe0f91def","observation_id":"18ba8698-1e52-45ca-8930-12de44413092","resolution":{"observed_at":"2026-08-04T11:06:48.586938Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2312.09767","last_updated":"2024-08-10T09:37:55Z","snapshot_observed_at":"2026-07-06T17:02:37.841641Z","submitted_at":"2023-12-15T13:15:42Z","title":"DreamTalk: When Emotional Talking Head Generation Meets Diffusion Probabilistic Models","version":3},"cited_work":{"arxiv_id":"2312.09767","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2312.09767","snapshot_observed_at":"2026-07-01T21:46:15.567696Z","title":"DreamTalk: When Emotional Talking Head Generation Meets Diffusion Probabilistic Models","venue":null,"work_id":"4352eabd-8ef9-4a9b-aecb-611a81401210","year":2023},"citing_paper":{"arxiv_id":"2511.04520","last_updated":"2026-05-20T15:14:20Z","snapshot_observed_at":"2026-07-31T21:47:41.347121Z","submitted_at":"2025-11-06T16:34:10Z","title":"THEval. Evaluation Framework for Talking Head Video Generation","version":4},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-05-21T19:00:48.999456Z"},"links":{"cited_paper":"/paper/2312.09767","citing_paper":"/paper/2511.04520"},"observation_digest":"sha256:4f1122e79b9e759bd08aa3c98f60a0e2e241161e59bed798965514679a56e9b4","observation_id":"91e59207-8b3d-409f-9592-f19c63a335b9","resolution":{"observed_at":"2026-05-21T19:04:19.299013Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2312.09767","last_updated":"2024-08-10T09:37:55Z","snapshot_observed_at":"2026-07-06T17:02:37.841641Z","submitted_at":"2023-12-15T13:15:42Z","title":"DreamTalk: When Emotional Talking Head Generation Meets Diffusion Probabilistic Models","version":3},"cited_work":{"arxiv_id":"2312.09767","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2312.09767","snapshot_observed_at":"2026-07-01T21:46:15.567696Z","title":"DreamTalk: When Emotional Talking Head Generation Meets Diffusion Probabilistic Models","venue":null,"work_id":"4352eabd-8ef9-4a9b-aecb-611a81401210","year":2023},"citing_paper":{"arxiv_id":"2604.10367","last_updated":"2026-04-11T22:34:21Z","snapshot_observed_at":"2026-08-04T17:39:32.698422Z","submitted_at":"2026-04-11T22:34:21Z","title":"Beyond Monologue: Interactive Talking-Listening Avatar Generation with Conversational Audio Context-Aware Kernels","version":1},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-05-10T15:16:53.603971Z"},"links":{"cited_paper":"/paper/2312.09767","citing_paper":"/paper/2604.10367"},"observation_digest":"sha256:0ab1d9f7411585af3f40aad0635d7384ef08030c6446a0e117a57a51d4beea52","observation_id":"9cc16b93-bc6a-42a8-9538-a897b52e120c","resolution":{"observed_at":"2026-05-11T10:56:01.777015Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2312.09767","last_updated":"2024-08-10T09:37:55Z","snapshot_observed_at":"2026-07-06T17:02:37.841641Z","submitted_at":"2023-12-15T13:15:42Z","title":"DreamTalk: When Emotional Talking Head Generation Meets Diffusion Probabilistic Models","version":3},"cited_work":{"arxiv_id":"2312.09767","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2312.09767","snapshot_observed_at":"2026-07-01T21:46:15.567696Z","title":"DreamTalk: When Emotional Talking Head Generation Meets Diffusion Probabilistic Models","venue":null,"work_id":"4352eabd-8ef9-4a9b-aecb-611a81401210","year":2023},"citing_paper":{"arxiv_id":"2604.23325","last_updated":"2026-04-25T14:29:58Z","snapshot_observed_at":"2026-07-06T23:09:34.300163Z","submitted_at":"2026-04-25T14:29:58Z","title":"EAD-Net: Emotion-Aware Talking Head Generation with Spatial Refinement and Temporal Coherence","version":1},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-05-08T08:27:41.839123Z"},"links":{"cited_paper":"/paper/2312.09767","citing_paper":"/paper/2604.23325"},"observation_digest":"sha256:b0e4baf59d6862b926cbd20b85f31b687faa814524e0dfdce2f96fabebaece98","observation_id":"0a37b97b-61f8-4dc0-b117-95322f754809","resolution":{"observed_at":"2026-05-11T20:36:11.220707Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2312.09767","last_updated":"2024-08-10T09:37:55Z","snapshot_observed_at":"2026-07-06T17:02:37.841641Z","submitted_at":"2023-12-15T13:15:42Z","title":"DreamTalk: When Emotional Talking Head Generation Meets Diffusion Probabilistic Models","version":3},"cited_work":{"arxiv_id":"2312.09767","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2312.09767","snapshot_observed_at":"2026-07-01T21:46:15.567696Z","title":"DreamTalk: When Emotional Talking Head Generation Meets Diffusion Probabilistic Models","venue":null,"work_id":"4352eabd-8ef9-4a9b-aecb-611a81401210","year":2023},"citing_paper":{"arxiv_id":"2604.23632","last_updated":"2026-04-26T09:46:58Z","snapshot_observed_at":"2026-07-06T23:09:48.137856Z","submitted_at":"2026-04-26T09:46:58Z","title":"Hallo-Live: Real-Time Streaming Joint Audio-Video Avatar Generation with Asynchronous Dual-Stream and Human-Centric Preference Distillation","version":1},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-05-08T06:56:19.795651Z"},"links":{"cited_paper":"/paper/2312.09767","citing_paper":"/paper/2604.23632"},"observation_digest":"sha256:946038ca21a7c31d9dd863fd81516700fe3e438ae995e3e6ec7ba95538281f27","observation_id":"008e79f9-6dda-4715-b264-bc208d659eeb","resolution":{"observed_at":"2026-05-11T21:06:12.869767Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2312.09767","last_updated":"2024-08-10T09:37:55Z","snapshot_observed_at":"2026-07-06T17:02:37.841641Z","submitted_at":"2023-12-15T13:15:42Z","title":"DreamTalk: When Emotional Talking Head Generation Meets Diffusion Probabilistic Models","version":3},"cited_work":{"arxiv_id":"2312.09767","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2312.09767","snapshot_observed_at":"2026-07-01T21:46:15.567696Z","title":"DreamTalk: When Emotional Talking Head Generation Meets Diffusion Probabilistic Models","venue":null,"work_id":"4352eabd-8ef9-4a9b-aecb-611a81401210","year":2023},"citing_paper":{"arxiv_id":"2605.25488","last_updated":"2026-05-25T06:45:29Z","snapshot_observed_at":"2026-08-02T09:17:40.384654Z","submitted_at":"2026-05-25T06:45:29Z","title":"Test-Time Self-Adaptive Conditioning for Stable Audio-Driven Talking-Head Generation","version":1},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-06-29T22:36:53.138354Z"},"links":{"cited_paper":"/paper/2312.09767","citing_paper":"/paper/2605.25488"},"observation_digest":"sha256:666b403673df395b4152193599b22e7ffa27d530f2a7b84039fd89c3a23562be","observation_id":"2e44f674-51f3-4aea-8360-9a8502e88f09","resolution":{"observed_at":"2026-06-29T22:44:01.740133Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2312.09767","last_updated":"2024-08-10T09:37:55Z","snapshot_observed_at":"2026-07-06T17:02:37.841641Z","submitted_at":"2023-12-15T13:15:42Z","title":"DreamTalk: When Emotional Talking Head Generation Meets Diffusion Probabilistic Models","version":3},"cited_work":{"arxiv_id":"2312.09767","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2312.09767","snapshot_observed_at":"2026-07-01T21:46:15.567696Z","title":"DreamTalk: When Emotional Talking Head Generation Meets Diffusion Probabilistic Models","venue":null,"work_id":"4352eabd-8ef9-4a9b-aecb-611a81401210","year":2023},"citing_paper":{"arxiv_id":"2606.01031","last_updated":"2026-05-31T05:44:42Z","snapshot_observed_at":"2026-07-06T23:41:39.172310Z","submitted_at":"2026-05-31T05:44:42Z","title":"Temporally-Aligned Evaluation for Audio-Driven Talking Head Generation","version":1},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-06-28T16:19:55.048831Z"},"links":{"cited_paper":"/paper/2312.09767","citing_paper":"/paper/2606.01031"},"observation_digest":"sha256:b99c40c1e6ec7ce6c1a92d6abed7013818a96b5cad4e4570d9f5a14f2ebba0b6","observation_id":"7c599578-2d61-45ab-8844-5890e33e7856","resolution":{"observed_at":"2026-07-01T21:46:15.569027Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}}],"links":{"evidence":"/evidence","html":"/paper/2312.09767/citation-record","integrity":"/paper/2312.09767/integrity","json":"/paper/2312.09767/citation-record.json","paper":"/paper/2312.09767"},"outbound":[],"paper":{"arxiv_id":"2312.09767","last_updated":"2024-08-10T09:37:55Z","latest_version":3,"primary_category":"cs.CV","snapshot_observed_at":"2026-07-06T17:02:37.841641Z","submitted_at":"2023-12-15T13:15:42Z","title":"DreamTalk: When Emotional Talking Head Generation Meets Diffusion Probabilistic Models"},"reference_resolution":{"displayed":0,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":0,"verified_exact":0,"verified_fuzzy":0},"total_outbound_references":0},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"thesis":"As of 9 August 2026, this Paper Citation Record lists 0 of 0 outbound references and 21 inbound Pith citation observations for arXiv:2312.09767."}