{"as_of":"2026-08-19T12:18:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:1b2a168e88df49257ad5a405a885050cb94b534b24b48b1c613cd7ec670d767a","coverage":[{"denominator":51,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":51,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-12T14:22:40.992230Z","state":"measured"},{"denominator":51,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":51,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-19T06:32:44.657259+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2411.15436/citation-record","integrity":"/paper/2411.15436/integrity","json":"/paper/2411.15436/citation-record.json","paper":"/paper/2411.15436"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T14:22:41.957998Z","title":null,"venue":null,"work_id":"6a33c7ab-d623-43d4-acf7-ab8b48f9d8a4","year":null},"citing_paper":{"arxiv_id":"2411.15436","last_updated":"2024-11-23T03:43:09Z","snapshot_observed_at":"2026-08-14T19:08:23.005879Z","submitted_at":"2024-11-23T03:43:09Z","title":"ConsistentAvatar: Learning to Diffuse Fully Consistent Talking Head Avatar with Temporal Guidance","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-12T14:22:40.732032Z"},"links":{"citing_paper":"/paper/2411.15436"},"observation_digest":"sha256:58086830abbe5e19d0d60707c95c1be79d0c720b8fbe2b48f907bcf97f18fe99","observation_id":"895a3c51-a187-49a6-99a3-d2f3c4331c6d","resolution":{"observed_at":"2026-08-12T14:22:41.963200Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T14:22:41.942152Z","title":null,"venue":null,"work_id":"066b7d4f-728d-4c6f-9baf-14a05b1ae65a","year":1999},"citing_paper":{"arxiv_id":"2411.15436","last_updated":"2024-11-23T03:43:09Z","snapshot_observed_at":"2026-08-14T19:08:23.005879Z","submitted_at":"2024-11-23T03:43:09Z","title":"ConsistentAvatar: Learning to Diffuse Fully Consistent Talking Head Avatar with Temporal Guidance","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-12T14:22:40.743131Z"},"links":{"citing_paper":"/paper/2411.15436"},"observation_digest":"sha256:20b68571ed091318cb1e038064ca2190f6fea24bd21612b81b4ab2141f9c32e3","observation_id":"5090cb0e-a8f1-4c06-8360-3b8d57c81869","resolution":{"observed_at":"2026-08-12T14:22:41.947139Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2204.11312","last_updated":"2022-04-24T15:58:35Z","snapshot_observed_at":"2026-08-18T22:48:12.554772Z","submitted_at":"2022-04-24T15:58:35Z","title":"EMOCA: Emotion Driven Monocular Face Capture and Animation","version":1},"cited_work":{"arxiv_id":"2204.11312","doi":null,"metadata_source":"pith","pith_arxiv_id":"2204.11312","snapshot_observed_at":"2026-08-12T14:22:41.685578Z","title":"EMOCA: Emotion Driven Monocular Face Capture and Animation","venue":"cs.CV","work_id":"a70127b1-5650-4c22-9a0f-3381e0e13dfe","year":2022},"citing_paper":{"arxiv_id":"2411.15436","last_updated":"2024-11-23T03:43:09Z","snapshot_observed_at":"2026-08-14T19:08:23.005879Z","submitted_at":"2024-11-23T03:43:09Z","title":"ConsistentAvatar: Learning to Diffuse Fully Consistent Talking Head Avatar with Temporal Guidance","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-12T14:22:40.748331Z"},"links":{"cited_paper":"/paper/2204.11312","citing_paper":"/paper/2411.15436"},"observation_digest":"sha256:71c91bb7e2b1cc062d64710e60e1581177c667a006812bc91abb59233de5564a","observation_id":"4fe39c4d-2f89-4ff9-aba5-1b68c1909f26","resolution":{"observed_at":"2026-08-12T14:22:41.691049Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2004.11660","last_updated":"2020-09-04T04:32:25Z","snapshot_observed_at":"2026-08-18T07:15:16.212243Z","submitted_at":"2020-04-24T11:21:13Z","title":"Disentangled and Controllable Face Image Generation via 3D Imitative-Contrastive Learning","version":2},"cited_work":{"arxiv_id":"2004.11660","doi":null,"metadata_source":"pith","pith_arxiv_id":"2004.11660","snapshot_observed_at":"2026-08-12T14:22:41.661902Z","title":"Disentangled and Controllable Face Image Generation via 3D Imitative-Contrastive Learning","venue":"cs.CV","work_id":"f626e3f2-3262-42ed-9016-f206fab9f255","year":2020},"citing_paper":{"arxiv_id":"2411.15436","last_updated":"2024-11-23T03:43:09Z","snapshot_observed_at":"2026-08-14T19:08:23.005879Z","submitted_at":"2024-11-23T03:43:09Z","title":"ConsistentAvatar: Learning to Diffuse Fully Consistent Talking Head Avatar with Temporal Guidance","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-12T14:22:40.753476Z"},"links":{"cited_paper":"/paper/2004.11660","citing_paper":"/paper/2411.15436"},"observation_digest":"sha256:fab37181e078f5fec98904ce0493da8da8c55790f320821dfeab53213370f2e2","observation_id":"77813dc9-426e-4d4f-baea-b26e65e4805d","resolution":{"observed_at":"2026-08-12T14:22:41.667228Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1903.08527","last_updated":"2020-04-09T16:42:09Z","snapshot_observed_at":"2026-08-17T18:54:43.196408Z","submitted_at":"2019-03-20T14:44:45Z","title":"Accurate 3D Face Reconstruction with Weakly-Supervised Learning: From Single Image to Image Set","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1903.08527","snapshot_observed_at":"2026-08-12T14:22:40.758957Z","title":null,"venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2411.15436","last_updated":"2024-11-23T03:43:09Z","snapshot_observed_at":"2026-08-14T19:08:23.005879Z","submitted_at":"2024-11-23T03:43:09Z","title":"ConsistentAvatar: Learning to Diffuse Fully Consistent Talking Head Avatar with Temporal Guidance","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-12T14:22:40.758957Z"},"links":{"cited_paper":"/paper/1903.08527","citing_paper":"/paper/2411.15436"},"observation_digest":"sha256:e549ec479556ecd1be9e1fd5f76bec8b49efd209aed50c0b59f844d0ffaf3f02","observation_id":"81f2e4c5-8cee-4043-a042-06dbe01af8e7","resolution":{"observed_at":"2026-08-12T14:22:40.758957Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2304.06711","last_updated":"2023-04-13T17:58:00Z","snapshot_observed_at":"2026-08-16T15:40:37.336216Z","submitted_at":"2023-04-13T17:58:00Z","title":"DiffusionRig: Learning Personalized Priors for Facial Appearance Editing","version":1},"cited_work":{"arxiv_id":"2304.06711","doi":null,"metadata_source":"pith","pith_arxiv_id":"2304.06711","snapshot_observed_at":"2026-08-12T14:22:41.620678Z","title":"DiffusionRig: Learning Personalized Priors for Facial Appearance Editing","venue":"cs.CV","work_id":"c5e70c7c-3b9a-4a97-a520-b3be70dc3a28","year":2023},"citing_paper":{"arxiv_id":"2411.15436","last_updated":"2024-11-23T03:43:09Z","snapshot_observed_at":"2026-08-14T19:08:23.005879Z","submitted_at":"2024-11-23T03:43:09Z","title":"ConsistentAvatar: Learning to Diffuse Fully Consistent Talking Head Avatar with Temporal Guidance","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-12T14:22:40.764111Z"},"links":{"cited_paper":"/paper/2304.06711","citing_paper":"/paper/2411.15436"},"observation_digest":"sha256:dc47aa3af7b66b95996cace22c26a46218f7fe53a912e9e4e9495a2e3373ebe5","observation_id":"d5e0521a-76db-4b8b-ba97-72b24b5dbb08","resolution":{"observed_at":"2026-08-12T14:22:41.626000Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2012.04012","last_updated":"2021-06-02T17:52:42Z","snapshot_observed_at":"2026-08-18T13:08:39.341588Z","submitted_at":"2020-12-07T19:30:45Z","title":"Learning an Animatable Detailed 3D Face Model from In-The-Wild Images","version":2},"cited_work":{"arxiv_id":"2012.04012","doi":null,"metadata_source":"pith","pith_arxiv_id":"2012.04012","snapshot_observed_at":"2026-08-12T14:22:41.596361Z","title":"Learning an Animatable Detailed 3D Face Model from In-The-Wild Images","venue":"cs.CV","work_id":"d05182bf-3036-4c03-9766-064e71999f6e","year":2020},"citing_paper":{"arxiv_id":"2411.15436","last_updated":"2024-11-23T03:43:09Z","snapshot_observed_at":"2026-08-14T19:08:23.005879Z","submitted_at":"2024-11-23T03:43:09Z","title":"ConsistentAvatar: Learning to Diffuse Fully Consistent Talking Head Avatar with Temporal Guidance","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-12T14:22:40.769303Z"},"links":{"cited_paper":"/paper/2012.04012","citing_paper":"/paper/2411.15436"},"observation_digest":"sha256:3a0a2ac3c90921c638a3fe94b936c877f11f21b3c8b56908f45e84241d82c3a3","observation_id":"796c8720-5be9-435c-80df-c2bc728e6dc1","resolution":{"observed_at":"2026-08-12T14:22:41.601944Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T14:22:41.926022Z","title":null,"venue":null,"work_id":"64497091-ca0a-41b8-a12b-4ee54a950fec","year":2021},"citing_paper":{"arxiv_id":"2411.15436","last_updated":"2024-11-23T03:43:09Z","snapshot_observed_at":"2026-08-14T19:08:23.005879Z","submitted_at":"2024-11-23T03:43:09Z","title":"ConsistentAvatar: Learning to Diffuse Fully Consistent Talking Head Avatar with Temporal Guidance","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-12T14:22:40.774982Z"},"links":{"citing_paper":"/paper/2411.15436"},"observation_digest":"sha256:95865d4c1e0bbe324cd206b58c15f4510a029579eb8d3bd394cb39cf0f223894","observation_id":"54cdcd3f-542a-4b69-b6bd-6a6e4f135b35","resolution":{"observed_at":"2026-08-12T14:22:41.931109Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2212.02761","last_updated":"2023-04-14T17:47:42Z","snapshot_observed_at":"2026-08-16T16:10:44.089556Z","submitted_at":"2022-12-06T05:24:42Z","title":"Learning Neural Parametric Head Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2212.02761","snapshot_observed_at":"2026-08-12T14:22:40.780171Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2411.15436","last_updated":"2024-11-23T03:43:09Z","snapshot_observed_at":"2026-08-14T19:08:23.005879Z","submitted_at":"2024-11-23T03:43:09Z","title":"ConsistentAvatar: Learning to Diffuse Fully Consistent Talking Head Avatar with Temporal Guidance","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-12T14:22:40.780171Z"},"links":{"cited_paper":"/paper/2212.02761","citing_paper":"/paper/2411.15436"},"observation_digest":"sha256:7f06703a30c20619fed2aab691c38f4b54be765723ac1650b0cb9326ddc99650","observation_id":"ad8fd179-2475-4254-8260-cf760939a372","resolution":{"observed_at":"2026-08-12T14:22:40.780171Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T14:22:41.909410Z","title":null,"venue":null,"work_id":"c8eb7f63-4759-4702-ad1c-46fe6199b2b3","year":2022},"citing_paper":{"arxiv_id":"2411.15436","last_updated":"2024-11-23T03:43:09Z","snapshot_observed_at":"2026-08-14T19:08:23.005879Z","submitted_at":"2024-11-23T03:43:09Z","title":"ConsistentAvatar: Learning to Diffuse Fully Consistent Talking Head Avatar with Temporal Guidance","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-12T14:22:40.785415Z"},"links":{"citing_paper":"/paper/2411.15436"},"observation_digest":"sha256:690d1ee9a8e75b1e03293f4d2ee24e818974763f80ef4659527c215db153a5e9","observation_id":"e8d8d28e-b3e5-49a8-91c2-c9129a5cf02e","resolution":{"observed_at":"2026-08-12T14:22:41.914417Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1911.09224","last_updated":"2019-11-21T00:07:43Z","snapshot_observed_at":"2026-08-15T10:10:42.867339Z","submitted_at":"2019-11-21T00:07:43Z","title":"FLNet: Landmark Driven Fetching and Learning Network for Faithful Talking Facial Animation Synthesis","version":1},"cited_work":{"arxiv_id":"1911.09224","doi":null,"metadata_source":"pith","pith_arxiv_id":"1911.09224","snapshot_observed_at":"2026-08-12T14:22:41.554133Z","title":"FLNet: Landmark Driven Fetching and Learning Network for Faithful Talking Facial Animation Synthesis","venue":"cs.CV","work_id":"04cc74d7-286b-4a9f-a64b-d0e6401915e7","year":2019},"citing_paper":{"arxiv_id":"2411.15436","last_updated":"2024-11-23T03:43:09Z","snapshot_observed_at":"2026-08-14T19:08:23.005879Z","submitted_at":"2024-11-23T03:43:09Z","title":"ConsistentAvatar: Learning to Diffuse Fully Consistent Talking Head Avatar with Temporal Guidance","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-12T14:22:40.790241Z"},"links":{"cited_paper":"/paper/1911.09224","citing_paper":"/paper/2411.15436"},"observation_digest":"sha256:98ffbeb282b0947334bca0c8091c0583aac5561fb3218a5bcb47f2c62cdb6ca8","observation_id":"05958a49-e682-4e08-8a7a-f8a30867ca89","resolution":{"observed_at":"2026-08-12T14:22:41.559646Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2401.00551","last_updated":"2023-12-31T17:41:48Z","snapshot_observed_at":"2026-08-17T06:02:52.451216Z","submitted_at":"2023-12-31T17:41:48Z","title":"A Generalist FaceX via Learning Unified Facial Representation","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2401.00551","snapshot_observed_at":"2026-08-12T14:22:40.795225Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2411.15436","last_updated":"2024-11-23T03:43:09Z","snapshot_observed_at":"2026-08-14T19:08:23.005879Z","submitted_at":"2024-11-23T03:43:09Z","title":"ConsistentAvatar: Learning to Diffuse Fully Consistent Talking Head Avatar with Temporal Guidance","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-12T14:22:40.795225Z"},"links":{"cited_paper":"/paper/2401.00551","citing_paper":"/paper/2411.15436"},"observation_digest":"sha256:bec58afde0ecd40d2ade69063e2e19106bfff2afa00bc52758b20762e9431794","observation_id":"302484db-6cb1-42a2-b9c6-3993fcd86cf1","resolution":{"observed_at":"2026-08-12T14:22:40.795225Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2006.11239","last_updated":"2020-12-16T21:15:05Z","snapshot_observed_at":"2026-08-10T05:21:27.485481Z","submitted_at":"2020-06-19T17:24:44Z","title":"Denoising Diffusion Probabilistic Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2006.11239","snapshot_observed_at":"2026-08-12T14:22:40.800584Z","title":null,"venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2411.15436","last_updated":"2024-11-23T03:43:09Z","snapshot_observed_at":"2026-08-14T19:08:23.005879Z","submitted_at":"2024-11-23T03:43:09Z","title":"ConsistentAvatar: Learning to Diffuse Fully Consistent Talking Head Avatar with Temporal Guidance","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-12T14:22:40.800584Z"},"links":{"cited_paper":"/paper/2006.11239","citing_paper":"/paper/2411.15436"},"observation_digest":"sha256:201567a17044c674e4f51cb807fc987a1bced2057e76be4e7ba71fa86c0e9f31","observation_id":"45240e48-2fa3-4118-870a-07d21b714b7f","resolution":{"observed_at":"2026-08-12T14:22:40.800584Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2104.07452","last_updated":"2021-05-20T02:48:26Z","snapshot_observed_at":"2026-08-16T18:31:23.444335Z","submitted_at":"2021-04-15T13:37:13Z","title":"Audio-Driven Emotional Video Portraits","version":2},"cited_work":{"arxiv_id":"2104.07452","doi":null,"metadata_source":"pith","pith_arxiv_id":"2104.07452","snapshot_observed_at":"2026-08-12T14:22:41.495306Z","title":"Audio-Driven Emotional Video Portraits","venue":"cs.CV","work_id":"f77e0610-d796-4d52-87fd-dcb40d313e78","year":2021},"citing_paper":{"arxiv_id":"2411.15436","last_updated":"2024-11-23T03:43:09Z","snapshot_observed_at":"2026-08-14T19:08:23.005879Z","submitted_at":"2024-11-23T03:43:09Z","title":"ConsistentAvatar: Learning to Diffuse Fully Consistent Talking Head Avatar with Temporal Guidance","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-12T14:22:40.806060Z"},"links":{"cited_paper":"/paper/2104.07452","citing_paper":"/paper/2411.15436"},"observation_digest":"sha256:92ceadcaababc9ecd10377fce8e2136d217c2d4d2137f1b2bc8ac81e3ae0c950","observation_id":"481106dd-69eb-4889-8708-041abe49d05b","resolution":{"observed_at":"2026-08-12T14:22:41.500654Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1812.04948","last_updated":"2019-03-29T11:08:46Z","snapshot_observed_at":"2026-08-14T17:44:45.577553Z","submitted_at":"2018-12-12T13:59:43Z","title":"A Style-Based Generator Architecture for Generative Adversarial Networks","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1812.04948","snapshot_observed_at":"2026-08-12T14:22:40.811550Z","title":null,"venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2411.15436","last_updated":"2024-11-23T03:43:09Z","snapshot_observed_at":"2026-08-14T19:08:23.005879Z","submitted_at":"2024-11-23T03:43:09Z","title":"ConsistentAvatar: Learning to Diffuse Fully Consistent Talking Head Avatar with Temporal Guidance","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-12T14:22:40.811550Z"},"links":{"cited_paper":"/paper/1812.04948","citing_paper":"/paper/2411.15436"},"observation_digest":"sha256:443833a6c6c81fc4961cef938422e8475c4859c5900ac2b4692ca90a0522ec00","observation_id":"aa904ff8-9065-4fc9-9715-faa03c54255b","resolution":{"observed_at":"2026-08-12T14:22:40.811550Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1912.04958","last_updated":"2020-03-23T17:21:07Z","snapshot_observed_at":"2026-08-18T11:01:59.622027Z","submitted_at":"2019-12-03T11:44:01Z","title":"Analyzing and Improving the Image Quality of StyleGAN","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1912.04958","snapshot_observed_at":"2026-08-12T14:22:40.817610Z","title":null,"venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2411.15436","last_updated":"2024-11-23T03:43:09Z","snapshot_observed_at":"2026-08-14T19:08:23.005879Z","submitted_at":"2024-11-23T03:43:09Z","title":"ConsistentAvatar: Learning to Diffuse Fully Consistent Talking Head Avatar with Temporal Guidance","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-12T14:22:40.817610Z"},"links":{"cited_paper":"/paper/1912.04958","citing_paper":"/paper/2411.15436"},"observation_digest":"sha256:f34840496500f2ed62407145553b693c606485a3be94324943ae2dc852873486","observation_id":"5d620a45-9d84-44d5-9646-341887cc28a4","resolution":{"observed_at":"2026-08-12T14:22:40.817610Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2206.08343","last_updated":"2022-06-16T17:45:23Z","snapshot_observed_at":"2026-08-16T16:52:27.862581Z","submitted_at":"2022-06-16T17:45:23Z","title":"Realistic One-shot Mesh-based Head Avatars","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2206.08343","snapshot_observed_at":"2026-08-12T14:22:40.822715Z","title":null,"venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2411.15436","last_updated":"2024-11-23T03:43:09Z","snapshot_observed_at":"2026-08-14T19:08:23.005879Z","submitted_at":"2024-11-23T03:43:09Z","title":"ConsistentAvatar: Learning to Diffuse Fully Consistent Talking Head Avatar with Temporal Guidance","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-12T14:22:40.822715Z"},"links":{"cited_paper":"/paper/2206.08343","citing_paper":"/paper/2411.15436"},"observation_digest":"sha256:c661ea07f4aac2fd5f0ac338ce026602d275f3eb67848e1e5d049728f7cd51c0","observation_id":"584d66ad-a30f-4275-a8c5-e03ed2eafd56","resolution":{"observed_at":"2026-08-12T14:22:40.822715Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2212.02802","last_updated":"2023-03-27T11:15:59Z","snapshot_observed_at":"2026-08-16T16:10:42.521494Z","submitted_at":"2022-12-06T07:41:51Z","title":"Diffusion Video Autoencoders: Toward Temporally Consistent Face Video Editing via Disentangled Video Encoding","version":2},"cited_work":{"arxiv_id":"2212.02802","doi":null,"metadata_source":"pith","pith_arxiv_id":"2212.02802","snapshot_observed_at":"2026-08-12T14:22:41.412866Z","title":"Diffusion Video Autoencoders: Toward Temporally Consistent Face Video Editing via Disentangled Video Encoding","venue":"cs.CV","work_id":"f5457747-2b45-4739-9926-ad448c691f69","year":2022},"citing_paper":{"arxiv_id":"2411.15436","last_updated":"2024-11-23T03:43:09Z","snapshot_observed_at":"2026-08-14T19:08:23.005879Z","submitted_at":"2024-11-23T03:43:09Z","title":"ConsistentAvatar: Learning to Diffuse Fully Consistent Talking Head Avatar with Temporal Guidance","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-12T14:22:40.828650Z"},"links":{"cited_paper":"/paper/2212.02802","citing_paper":"/paper/2411.15436"},"observation_digest":"sha256:b71e52e7672c93c5a515f380974e264ac00c78396f80cb83dbcec9fb87239646","observation_id":"0bdf380b-40c9-452f-86d6-b91ba983c41b","resolution":{"observed_at":"2026-08-12T14:22:41.418402Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2304.07060","last_updated":"2023-04-14T11:31:49Z","snapshot_observed_at":"2026-08-16T15:40:27.596704Z","submitted_at":"2023-04-14T11:31:49Z","title":"DCFace: Synthetic Face Generation with Dual Condition Diffusion Model","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2304.07060","snapshot_observed_at":"2026-08-12T14:22:40.833406Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2411.15436","last_updated":"2024-11-23T03:43:09Z","snapshot_observed_at":"2026-08-14T19:08:23.005879Z","submitted_at":"2024-11-23T03:43:09Z","title":"ConsistentAvatar: Learning to Diffuse Fully Consistent Talking Head Avatar with Temporal Guidance","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-12T14:22:40.833406Z"},"links":{"cited_paper":"/paper/2304.07060","citing_paper":"/paper/2411.15436"},"observation_digest":"sha256:1cff5e23e5bbc15f62ce929ec93b78dd4817ca18fd5cf3ecbe5def17e6767197","observation_id":"1107de5b-22e2-4d18-9438-26e9bbd94da6","resolution":{"observed_at":"2026-08-12T14:22:40.833406Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T14:22:40.838416Z","title":"Kingma and Jimmy Ba","venue":null,"work_id":null,"year":2015},"citing_paper":{"arxiv_id":"2411.15436","last_updated":"2024-11-23T03:43:09Z","snapshot_observed_at":"2026-08-14T19:08:23.005879Z","submitted_at":"2024-11-23T03:43:09Z","title":"ConsistentAvatar: Learning to Diffuse Fully Consistent Talking Head Avatar with Temporal Guidance","version":1},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-12T14:22:40.838416Z"},"links":{"citing_paper":"/paper/2411.15436"},"observation_digest":"sha256:b7d2f6f9afa2283952738d3b469e97a214dc942c987b9081e385e6c9d5485ff0","observation_id":"135f5448-27a6-41d6-891a-2c3171c6c2da","resolution":{"observed_at":"2026-08-12T14:22:40.838416Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2311.18635","last_updated":"2024-04-16T18:07:51Z","snapshot_observed_at":"2026-08-16T14:38:48.145526Z","submitted_at":"2023-11-30T15:43:13Z","title":"DiffusionAvatars: Deferred Diffusion for High-fidelity 3D Head Avatars","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2311.18635","snapshot_observed_at":"2026-08-12T14:22:40.843585Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2411.15436","last_updated":"2024-11-23T03:43:09Z","snapshot_observed_at":"2026-08-14T19:08:23.005879Z","submitted_at":"2024-11-23T03:43:09Z","title":"ConsistentAvatar: Learning to Diffuse Fully Consistent Talking Head Avatar with Temporal Guidance","version":1},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-12T14:22:40.843585Z"},"links":{"cited_paper":"/paper/2311.18635","citing_paper":"/paper/2411.15436"},"observation_digest":"sha256:63808475a87ab0546e04ed0276f8acbf3d34f9156863d4fec46f1a6b12de886a","observation_id":"897721db-361f-4291-949b-1a89d74f5e2f","resolution":{"observed_at":"2026-08-12T14:22:40.843585Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T14:22:41.882466Z","title":"Black, Hao Li, and Javier Romero","venue":null,"work_id":"a1d43b1f-ab45-4992-839a-29d45fc8ed06","year":2017},"citing_paper":{"arxiv_id":"2411.15436","last_updated":"2024-11-23T03:43:09Z","snapshot_observed_at":"2026-08-14T19:08:23.005879Z","submitted_at":"2024-11-23T03:43:09Z","title":"ConsistentAvatar: Learning to Diffuse Fully Consistent Talking Head Avatar with Temporal Guidance","version":1},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-12T14:22:40.848451Z"},"links":{"citing_paper":"/paper/2411.15436"},"observation_digest":"sha256:78b719391c9d33f4087e3be3c81d0caf89f66aabc6747d732c327884c4180634","observation_id":"bbbee7db-ae3f-4afe-bfd5-efea24d12992","resolution":{"observed_at":"2026-08-12T14:22:41.887719Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2310.04378","last_updated":"2023-10-06T17:11:58Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2023-10-06T17:11:58Z","title":"Latent Consistency Models: Synthesizing High-Resolution Images with Few-Step Inference","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2310.04378","snapshot_observed_at":"2026-08-12T14:22:40.854085Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2411.15436","last_updated":"2024-11-23T03:43:09Z","snapshot_observed_at":"2026-08-14T19:08:23.005879Z","submitted_at":"2024-11-23T03:43:09Z","title":"ConsistentAvatar: Learning to Diffuse Fully Consistent Talking Head Avatar with Temporal Guidance","version":1},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-12T14:22:40.854085Z"},"links":{"cited_paper":"/paper/2310.04378","citing_paper":"/paper/2411.15436"},"observation_digest":"sha256:54691a8a95506f2feb318bb5260737819f589782073c4649394e2ef6e0e44ad9","observation_id":"af5bf530-0fcc-42cd-8372-79e4210f91b1","resolution":{"observed_at":"2026-08-12T14:22:40.854085Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T14:22:41.866081Z","title":null,"venue":null,"work_id":"af013a4a-25ef-4ded-adfc-0f6a193c9a88","year":2020},"citing_paper":{"arxiv_id":"2411.15436","last_updated":"2024-11-23T03:43:09Z","snapshot_observed_at":"2026-08-14T19:08:23.005879Z","submitted_at":"2024-11-23T03:43:09Z","title":"ConsistentAvatar: Learning to Diffuse Fully Consistent Talking Head Avatar with Temporal Guidance","version":1},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-12T14:22:40.859640Z"},"links":{"citing_paper":"/paper/2411.15436"},"observation_digest":"sha256:07ad9398cc8140744039d7b7a199bd1cc40d6f1d56a0cd6ede27e3c2e75dd267","observation_id":"d3ef5b10-534e-468f-b708-d0c3cf5e427f","resolution":{"observed_at":"2026-08-12T14:22:41.871100Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2102.09672","last_updated":"2021-02-18T23:44:17Z","snapshot_observed_at":"2026-08-17T08:18:36.930250Z","submitted_at":"2021-02-18T23:44:17Z","title":"Improved Denoising Diffusion Probabilistic Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2102.09672","snapshot_observed_at":"2026-08-12T14:22:40.864303Z","title":null,"venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2411.15436","last_updated":"2024-11-23T03:43:09Z","snapshot_observed_at":"2026-08-14T19:08:23.005879Z","submitted_at":"2024-11-23T03:43:09Z","title":"ConsistentAvatar: Learning to Diffuse Fully Consistent Talking Head Avatar with Temporal Guidance","version":1},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-08-12T14:22:40.864303Z"},"links":{"cited_paper":"/paper/2102.09672","citing_paper":"/paper/2411.15436"},"observation_digest":"sha256:d3481b765b3d18bf5b672ef4bc45afacff4a7462ea0fec7278226033d108bbad","observation_id":"1686ee07-eaeb-45a7-8aab-8cbaa65e5d4c","resolution":{"observed_at":"2026-08-12T14:22:40.864303Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2204.08839","last_updated":"2022-09-27T08:00:14Z","snapshot_observed_at":"2026-08-16T17:06:06.068034Z","submitted_at":"2022-04-19T12:10:18Z","title":"Unsupervised Learning of Efficient Geometry-Aware Neural Articulated Representations","version":2},"cited_work":{"arxiv_id":"2204.08839","doi":null,"metadata_source":"pith","pith_arxiv_id":"2204.08839","snapshot_observed_at":"2026-08-12T14:22:41.319788Z","title":"Unsupervised Learning of Efficient Geometry-Aware Neural Articulated Representations","venue":"cs.CV","work_id":"c2261fd8-c759-434a-869b-daff0d3db40f","year":2022},"citing_paper":{"arxiv_id":"2411.15436","last_updated":"2024-11-23T03:43:09Z","snapshot_observed_at":"2026-08-14T19:08:23.005879Z","submitted_at":"2024-11-23T03:43:09Z","title":"ConsistentAvatar: Learning to Diffuse Fully Consistent Talking Head Avatar with Temporal Guidance","version":1},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-08-12T14:22:40.869833Z"},"links":{"cited_paper":"/paper/2204.08839","citing_paper":"/paper/2411.15436"},"observation_digest":"sha256:af3ff6136ac33868155c187e8f6518363e6197e5f4a5d3c207238b368887b36b","observation_id":"938042a2-c433-40ef-a7bb-44c5021c536c","resolution":{"observed_at":"2026-08-12T14:22:41.325415Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2303.11089","last_updated":"2023-08-25T04:50:47Z","snapshot_observed_at":"2026-08-16T15:46:53.619702Z","submitted_at":"2023-03-20T13:22:04Z","title":"EmoTalk: Speech-Driven Emotional Disentanglement for 3D Face Animation","version":2},"cited_work":{"arxiv_id":"2303.11089","doi":null,"metadata_source":"pith","pith_arxiv_id":"2303.11089","snapshot_observed_at":"2026-08-12T14:22:41.295271Z","title":"EmoTalk: Speech-Driven Emotional Disentanglement for 3D Face Animation","venue":"cs.CV","work_id":"957fb89b-234e-4dfe-a538-0f87df64ea2e","year":2023},"citing_paper":{"arxiv_id":"2411.15436","last_updated":"2024-11-23T03:43:09Z","snapshot_observed_at":"2026-08-14T19:08:23.005879Z","submitted_at":"2024-11-23T03:43:09Z","title":"ConsistentAvatar: Learning to Diffuse Fully Consistent Talking Head Avatar with Temporal Guidance","version":1},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-08-12T14:22:40.875307Z"},"links":{"cited_paper":"/paper/2303.11089","citing_paper":"/paper/2411.15436"},"observation_digest":"sha256:5f3fa9cab517f54048c35c43d897e76dd3825c6de0e31f45a613dc9702719846","observation_id":"a8865b72-0145-4ae5-ad99-442c727ef146","resolution":{"observed_at":"2026-08-12T14:22:41.300549Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2307.01952","last_updated":"2023-07-04T23:04:57Z","snapshot_observed_at":"2026-08-14T22:54:08.184266Z","submitted_at":"2023-07-04T23:04:57Z","title":"SDXL: Improving Latent Diffusion Models for High-Resolution Image Synthesis","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2307.01952","snapshot_observed_at":"2026-08-12T14:22:40.880268Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2411.15436","last_updated":"2024-11-23T03:43:09Z","snapshot_observed_at":"2026-08-14T19:08:23.005879Z","submitted_at":"2024-11-23T03:43:09Z","title":"ConsistentAvatar: Learning to Diffuse Fully Consistent Talking Head Avatar with Temporal Guidance","version":1},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-08-12T14:22:40.880268Z"},"links":{"cited_paper":"/paper/2307.01952","citing_paper":"/paper/2411.15436"},"observation_digest":"sha256:764121d4fa9d56920ab6956b0c35b839dd36e86f1a3f17bd27697028e1fbc207","observation_id":"526b711c-c7a0-459a-9e34-b77320cdbfb1","resolution":{"observed_at":"2026-08-12T14:22:40.880268Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2312.02069","last_updated":"2024-03-28T15:51:05Z","snapshot_observed_at":"2026-08-17T23:46:10.094846Z","submitted_at":"2023-12-04T17:28:35Z","title":"GaussianAvatars: Photorealistic Head Avatars with Rigged 3D Gaussians","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2312.02069","snapshot_observed_at":"2026-08-12T14:22:40.886025Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2411.15436","last_updated":"2024-11-23T03:43:09Z","snapshot_observed_at":"2026-08-14T19:08:23.005879Z","submitted_at":"2024-11-23T03:43:09Z","title":"ConsistentAvatar: Learning to Diffuse Fully Consistent Talking Head Avatar with Temporal Guidance","version":1},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-08-12T14:22:40.886025Z"},"links":{"cited_paper":"/paper/2312.02069","citing_paper":"/paper/2411.15436"},"observation_digest":"sha256:b58b2926bead8402252bac887a61e5ff1cad331fdb3c32dd76fced78afbe8379","observation_id":"74c37eb5-c31d-4d29-a365-31eb3b9f559e","resolution":{"observed_at":"2026-08-12T14:22:40.886025Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2103.00020","last_updated":"2021-02-26T19:04:58Z","snapshot_observed_at":"2026-07-06T10:45:03.059688Z","submitted_at":"2021-02-26T19:04:58Z","title":"Learning Transferable Visual Models From Natural Language Supervision","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2103.00020","snapshot_observed_at":"2026-08-12T14:22:40.891364Z","title":null,"venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2411.15436","last_updated":"2024-11-23T03:43:09Z","snapshot_observed_at":"2026-08-14T19:08:23.005879Z","submitted_at":"2024-11-23T03:43:09Z","title":"ConsistentAvatar: Learning to Diffuse Fully Consistent Talking Head Avatar with Temporal Guidance","version":1},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-08-12T14:22:40.891364Z"},"links":{"cited_paper":"/paper/2103.00020","citing_paper":"/paper/2411.15436"},"observation_digest":"sha256:0c5db90240cf5ab88ba0a90af3ce19407fce08efe79117d722c9ca73f9f38b39","observation_id":"ae0ea332-53dd-4af7-be87-8b8b7124e398","resolution":{"observed_at":"2026-08-12T14:22:40.891364Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T14:22:41.849117Z","title":"Dauphin, Percy Liang, and Jennifer Wortman Vaughan (Eds.)","venue":null,"work_id":"04bad2a4-cbd8-4b92-bc73-a6028277bb4a","year":2021},"citing_paper":{"arxiv_id":"2411.15436","last_updated":"2024-11-23T03:43:09Z","snapshot_observed_at":"2026-08-14T19:08:23.005879Z","submitted_at":"2024-11-23T03:43:09Z","title":"ConsistentAvatar: Learning to Diffuse Fully Consistent Talking Head Avatar with Temporal Guidance","version":1},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-08-12T14:22:40.896987Z"},"links":{"citing_paper":"/paper/2411.15436"},"observation_digest":"sha256:9af135314f4e992092e11dee8e6036f8a28019428ea84250d8b71e144259a175","observation_id":"2e115603-25a0-4497-8704-7ce27991b674","resolution":{"observed_at":"2026-08-12T14:22:41.854248Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2109.08379","last_updated":"2021-09-17T07:24:16Z","snapshot_observed_at":"2026-08-16T17:55:57.918722Z","submitted_at":"2021-09-17T07:24:16Z","title":"PIRenderer: Controllable Portrait Image Generation via Semantic Neural Rendering","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2109.08379","snapshot_observed_at":"2026-08-12T14:22:40.901935Z","title":"Li, and Shan Liu","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2411.15436","last_updated":"2024-11-23T03:43:09Z","snapshot_observed_at":"2026-08-14T19:08:23.005879Z","submitted_at":"2024-11-23T03:43:09Z","title":"ConsistentAvatar: Learning to Diffuse Fully Consistent Talking Head Avatar with Temporal Guidance","version":1},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-08-12T14:22:40.901935Z"},"links":{"cited_paper":"/paper/2109.08379","citing_paper":"/paper/2411.15436"},"observation_digest":"sha256:7345df802348027787ccb67c5574c3ace0f749e51112e9572ecce07c3cfc95fe","observation_id":"ed2debcf-bdd1-4bdb-b8c6-5246da478819","resolution":{"observed_at":"2026-08-12T14:22:40.901935Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T14:22:40.906947Z","title":null,"venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2411.15436","last_updated":"2024-11-23T03:43:09Z","snapshot_observed_at":"2026-08-14T19:08:23.005879Z","submitted_at":"2024-11-23T03:43:09Z","title":"ConsistentAvatar: Learning to Diffuse Fully Consistent Talking Head Avatar with Temporal Guidance","version":1},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-08-12T14:22:40.906947Z"},"links":{"citing_paper":"/paper/2411.15436"},"observation_digest":"sha256:9a946adca6078ad08324bb61d09db943a9c5a92097267e958142835f871531d6","observation_id":"92634b80-4e4e-4e66-b730-3f70586de3a6","resolution":{"observed_at":"2026-08-12T14:22:40.906947Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1905.06817","last_updated":"2019-05-16T14:57:45Z","snapshot_observed_at":"2026-08-14T16:31:10.037460Z","submitted_at":"2019-05-16T14:57:45Z","title":"Learning to Regress 3D Face Shape and Expression from an Image without 3D Supervision","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1905.06817","snapshot_observed_at":"2026-08-12T14:22:40.911826Z","title":null,"venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2411.15436","last_updated":"2024-11-23T03:43:09Z","snapshot_observed_at":"2026-08-14T19:08:23.005879Z","submitted_at":"2024-11-23T03:43:09Z","title":"ConsistentAvatar: Learning to Diffuse Fully Consistent Talking Head Avatar with Temporal Guidance","version":1},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-08-12T14:22:40.911826Z"},"links":{"cited_paper":"/paper/1905.06817","citing_paper":"/paper/2411.15436"},"observation_digest":"sha256:0d5c4ebfb18387faaf732df2ee31b30ef19ea9c18b26a8c1a09c92398c998a2f","observation_id":"17d3bc6a-71cc-485b-9c48-01bb741b08f1","resolution":{"observed_at":"2026-08-12T14:22:40.911826Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2301.03786","last_updated":"2023-04-20T08:51:11Z","snapshot_observed_at":"2026-08-19T07:51:37.756438Z","submitted_at":"2023-01-10T05:11:25Z","title":"DiffTalk: Crafting Diffusion Models for Generalized Audio-Driven Portraits Animation","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2301.03786","snapshot_observed_at":"2026-08-12T14:22:40.916684Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2411.15436","last_updated":"2024-11-23T03:43:09Z","snapshot_observed_at":"2026-08-14T19:08:23.005879Z","submitted_at":"2024-11-23T03:43:09Z","title":"ConsistentAvatar: Learning to Diffuse Fully Consistent Talking Head Avatar with Temporal Guidance","version":1},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-08-12T14:22:40.916684Z"},"links":{"cited_paper":"/paper/2301.03786","citing_paper":"/paper/2411.15436"},"observation_digest":"sha256:144c83494249dd8483ac7496be70713b450bde5eb8f877a459524933a4ce497c","observation_id":"c3dd463d-700b-4397-8f8f-0fa3797a208d","resolution":{"observed_at":"2026-08-12T14:22:40.916684Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2003.00196","last_updated":"2020-10-01T15:26:15Z","snapshot_observed_at":"2026-08-13T06:25:00.599960Z","submitted_at":"2020-02-29T07:08:56Z","title":"First Order Motion Model for Image Animation","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2003.00196","snapshot_observed_at":"2026-08-12T14:22:40.921625Z","title":null,"venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2411.15436","last_updated":"2024-11-23T03:43:09Z","snapshot_observed_at":"2026-08-14T19:08:23.005879Z","submitted_at":"2024-11-23T03:43:09Z","title":"ConsistentAvatar: Learning to Diffuse Fully Consistent Talking Head Avatar with Temporal Guidance","version":1},"reference_index":36,"source":"pdf_text","source_observed_at":"2026-08-12T14:22:40.921625Z"},"links":{"cited_paper":"/paper/2003.00196","citing_paper":"/paper/2411.15436"},"observation_digest":"sha256:53c0067ca3896305fd4bcb8205cd87a50a77658b9029dd7d561b457b32823c4e","observation_id":"2686ea4f-5a85-4014-9231-a59b126d80b3","resolution":{"observed_at":"2026-08-12T14:22:40.921625Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T14:22:41.822608Z","title":null,"venue":null,"work_id":"2ce5b7af-59dd-4eb6-ae70-cf73fe7b7e7e","year":null},"citing_paper":{"arxiv_id":"2411.15436","last_updated":"2024-11-23T03:43:09Z","snapshot_observed_at":"2026-08-14T19:08:23.005879Z","submitted_at":"2024-11-23T03:43:09Z","title":"ConsistentAvatar: Learning to Diffuse Fully Consistent Talking Head Avatar with Temporal Guidance","version":1},"reference_index":37,"source":"pdf_text","source_observed_at":"2026-08-12T14:22:40.926736Z"},"links":{"citing_paper":"/paper/2411.15436"},"observation_digest":"sha256:104007f37c7b2973026a2dd4caf3662fbfaf3be9ff64a25c125e33c58066045d","observation_id":"06b92161-906a-414b-bfed-19f60774f8f3","resolution":{"observed_at":"2026-08-12T14:22:41.827380Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T14:22:41.805304Z","title":null,"venue":null,"work_id":"3ec9cc5c-ef14-4153-a08e-a9c97cfc16eb","year":2023},"citing_paper":{"arxiv_id":"2411.15436","last_updated":"2024-11-23T03:43:09Z","snapshot_observed_at":"2026-08-14T19:08:23.005879Z","submitted_at":"2024-11-23T03:43:09Z","title":"ConsistentAvatar: Learning to Diffuse Fully Consistent Talking Head Avatar with Temporal Guidance","version":1},"reference_index":38,"source":"pdf_text","source_observed_at":"2026-08-12T14:22:40.936909Z"},"links":{"citing_paper":"/paper/2411.15436"},"observation_digest":"sha256:d9306141b6366fd77fa0592fb2f92ec189cf00fd016502a07e191dd0e1515d0d","observation_id":"996bfa01-78b3-4b1a-aff8-ad12dd304804","resolution":{"observed_at":"2026-08-12T14:22:41.810897Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2205.01155","last_updated":"2022-05-02T18:41:36Z","snapshot_observed_at":"2026-08-16T17:03:05.283479Z","submitted_at":"2022-05-02T18:41:36Z","title":"Emotion-Controllable Generalized Talking Face Generation","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2205.01155","snapshot_observed_at":"2026-08-12T14:22:40.931760Z","title":"arXiv:2205.01155 [cs.CV]","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2411.15436","last_updated":"2024-11-23T03:43:09Z","snapshot_observed_at":"2026-08-14T19:08:23.005879Z","submitted_at":"2024-11-23T03:43:09Z","title":"ConsistentAvatar: Learning to Diffuse Fully Consistent Talking Head Avatar with Temporal Guidance","version":1},"reference_index":39,"source":"pdf_text","source_observed_at":"2026-08-12T14:22:40.931760Z"},"links":{"cited_paper":"/paper/2205.01155","citing_paper":"/paper/2411.15436"},"observation_digest":"sha256:4934f1ce3f386e07263893dd47f77d87677a2f8d242fe6b2820a69638476424a","observation_id":"dbdee44e-58d5-45b8-adcb-61777c5e40e4","resolution":{"observed_at":"2026-08-12T14:22:40.931760Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T14:22:41.770739Z","title":null,"venue":null,"work_id":"ee8a1f2f-6048-4535-8810-6f3266ea6974","year":2020},"citing_paper":{"arxiv_id":"2411.15436","last_updated":"2024-11-23T03:43:09Z","snapshot_observed_at":"2026-08-14T19:08:23.005879Z","submitted_at":"2024-11-23T03:43:09Z","title":"ConsistentAvatar: Learning to Diffuse Fully Consistent Talking Head Avatar with Temporal Guidance","version":1},"reference_index":40,"source":"pdf_text","source_observed_at":"2026-08-12T14:22:40.947326Z"},"links":{"citing_paper":"/paper/2411.15436"},"observation_digest":"sha256:1ef856e1a3be6f1635278c01bb6fe5bcbfd3f78c7ce915323af275a24a0d9c42","observation_id":"0d2e2bcc-fe31-40a4-b972-a0c4468ce548","resolution":{"observed_at":"2026-08-12T14:22:41.775839Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T14:22:41.786885Z","title":null,"venue":null,"work_id":"039173da-34ee-49e8-b14f-d5edc0b69ac6","year":2020},"citing_paper":{"arxiv_id":"2411.15436","last_updated":"2024-11-23T03:43:09Z","snapshot_observed_at":"2026-08-14T19:08:23.005879Z","submitted_at":"2024-11-23T03:43:09Z","title":"ConsistentAvatar: Learning to Diffuse Fully Consistent Talking Head Avatar with Temporal Guidance","version":1},"reference_index":41,"source":"pdf_text","source_observed_at":"2026-08-12T14:22:40.942447Z"},"links":{"citing_paper":"/paper/2411.15436"},"observation_digest":"sha256:fc0aa6e90592885c46cdc7b6144b8f662ab456a372aacff561d149b479abc74b","observation_id":"c61025a3-f3b5-46d3-9fc7-4e78423976dc","resolution":{"observed_at":"2026-08-12T14:22:41.791863Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T14:22:41.754159Z","title":null,"venue":null,"work_id":"de63e2bb-6a09-406c-8e55-7b9847c36568","year":2023},"citing_paper":{"arxiv_id":"2411.15436","last_updated":"2024-11-23T03:43:09Z","snapshot_observed_at":"2026-08-14T19:08:23.005879Z","submitted_at":"2024-11-23T03:43:09Z","title":"ConsistentAvatar: Learning to Diffuse Fully Consistent Talking Head Avatar with Temporal Guidance","version":1},"reference_index":42,"source":"pdf_text","source_observed_at":"2026-08-12T14:22:40.957398Z"},"links":{"citing_paper":"/paper/2411.15436"},"observation_digest":"sha256:7916f71edf8736b5cb616e762a2f96c29dcbe97b5a9b97ec57f1df5565d4b3b5","observation_id":"a7446fae-07ad-4a66-a352-b30c9b9a8a0c","resolution":{"observed_at":"2026-08-12T14:22:41.759267Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2312.07669","last_updated":"2025-03-27T08:47:12Z","snapshot_observed_at":"2026-08-16T14:35:21.236501Z","submitted_at":"2023-12-12T19:03:04Z","title":"GMTalker: Gaussian Mixture-based Audio-Driven Emotional Talking Video Portraits","version":3},"cited_work":{"arxiv_id":"2312.07669","doi":null,"metadata_source":"pith","pith_arxiv_id":"2312.07669","snapshot_observed_at":"2026-08-12T14:22:41.130714Z","title":"GMTalker: Gaussian Mixture-based Audio-Driven Emotional Talking Video Portraits","venue":"cs.CV","work_id":"ba07066e-fe95-435a-8454-10fa05491040","year":2023},"citing_paper":{"arxiv_id":"2411.15436","last_updated":"2024-11-23T03:43:09Z","snapshot_observed_at":"2026-08-14T19:08:23.005879Z","submitted_at":"2024-11-23T03:43:09Z","title":"ConsistentAvatar: Learning to Diffuse Fully Consistent Talking Head Avatar with Temporal Guidance","version":1},"reference_index":43,"source":"pdf_text","source_observed_at":"2026-08-12T14:22:40.952395Z"},"links":{"cited_paper":"/paper/2312.07669","citing_paper":"/paper/2411.15436"},"observation_digest":"sha256:04856e1ce2d8e0dbea3c575aa5667f6f07355a350039e57ad8bcc1a5c9d6110a","observation_id":"aa34fc1e-72e2-4e5e-983f-42e3a37fea19","resolution":{"observed_at":"2026-08-12T14:22:41.136134Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2302.05543","last_updated":"2023-11-26T22:26:12Z","snapshot_observed_at":"2026-08-14T19:07:37.876970Z","submitted_at":"2023-02-10T23:12:37Z","title":"Adding Conditional Control to Text-to-Image Diffusion Models","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2302.05543","snapshot_observed_at":"2026-08-12T14:22:40.967296Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2411.15436","last_updated":"2024-11-23T03:43:09Z","snapshot_observed_at":"2026-08-14T19:08:23.005879Z","submitted_at":"2024-11-23T03:43:09Z","title":"ConsistentAvatar: Learning to Diffuse Fully Consistent Talking Head Avatar with Temporal Guidance","version":1},"reference_index":44,"source":"pdf_text","source_observed_at":"2026-08-12T14:22:40.967296Z"},"links":{"cited_paper":"/paper/2302.05543","citing_paper":"/paper/2411.15436"},"observation_digest":"sha256:ea65ee9418a1666c25de2cc0e5b1c5b86c68db595423253ea298c705a869a65e","observation_id":"615d101a-ae1d-45c9-889b-7450cd7f94df","resolution":{"observed_at":"2026-08-12T14:22:40.967296Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2308.06721","last_updated":"2023-08-13T08:34:51Z","snapshot_observed_at":"2026-07-06T16:05:39.158819Z","submitted_at":"2023-08-13T08:34:51Z","title":"IP-Adapter: Text Compatible Image Prompt Adapter for Text-to-Image Diffusion Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2308.06721","snapshot_observed_at":"2026-08-12T14:22:40.962182Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2411.15436","last_updated":"2024-11-23T03:43:09Z","snapshot_observed_at":"2026-08-14T19:08:23.005879Z","submitted_at":"2024-11-23T03:43:09Z","title":"ConsistentAvatar: Learning to Diffuse Fully Consistent Talking Head Avatar with Temporal Guidance","version":1},"reference_index":45,"source":"pdf_text","source_observed_at":"2026-08-12T14:22:40.962182Z"},"links":{"cited_paper":"/paper/2308.06721","citing_paper":"/paper/2411.15436"},"observation_digest":"sha256:80b8efbf3e8506e3e1f5fa4bd1ce743672ae8130c24d0367fcd3e2caebe67437","observation_id":"f343a9ef-0c82-4fd6-a672-e96dccb282eb","resolution":{"observed_at":"2026-08-12T14:22:40.962182Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2109.00471","last_updated":"2021-09-03T04:05:08Z","snapshot_observed_at":"2026-08-16T17:59:28.346316Z","submitted_at":"2021-09-01T16:23:57Z","title":"Sparse to Dense Motion Transfer for Face Image Animation","version":2},"cited_work":{"arxiv_id":"2109.00471","doi":null,"metadata_source":"pith","pith_arxiv_id":"2109.00471","snapshot_observed_at":"2026-08-12T14:22:41.050621Z","title":"Sparse to Dense Motion Transfer for Face Image Animation","venue":"cs.CV","work_id":"efb6c7b7-ddc2-4233-96a6-c2009b88a5ef","year":2021},"citing_paper":{"arxiv_id":"2411.15436","last_updated":"2024-11-23T03:43:09Z","snapshot_observed_at":"2026-08-14T19:08:23.005879Z","submitted_at":"2024-11-23T03:43:09Z","title":"ConsistentAvatar: Learning to Diffuse Fully Consistent Talking Head Avatar with Temporal Guidance","version":1},"reference_index":46,"source":"pdf_text","source_observed_at":"2026-08-12T14:22:40.977100Z"},"links":{"cited_paper":"/paper/2109.00471","citing_paper":"/paper/2411.15436"},"observation_digest":"sha256:50abc191c969cd09d0c284ff8fb7b52dfeff94a5ae40bebc2b6b2610b10d9f79","observation_id":"cdc5199d-7f51-49bd-97c0-2c5599edbb08","resolution":{"observed_at":"2026-08-12T14:22:41.058386Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2211.12194","last_updated":"2023-03-13T08:40:32Z","snapshot_observed_at":"2026-08-18T03:26:35.867985Z","submitted_at":"2022-11-22T11:35:07Z","title":"SadTalker: Learning Realistic 3D Motion Coefficients for Stylized Audio-Driven Single Image Talking Face Animation","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2211.12194","snapshot_observed_at":"2026-08-12T14:22:40.972138Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2411.15436","last_updated":"2024-11-23T03:43:09Z","snapshot_observed_at":"2026-08-14T19:08:23.005879Z","submitted_at":"2024-11-23T03:43:09Z","title":"ConsistentAvatar: Learning to Diffuse Fully Consistent Talking Head Avatar with Temporal Guidance","version":1},"reference_index":47,"source":"pdf_text","source_observed_at":"2026-08-12T14:22:40.972138Z"},"links":{"cited_paper":"/paper/2211.12194","citing_paper":"/paper/2411.15436"},"observation_digest":"sha256:5bbeb13601ede3014bcadc63037fa1df8983af655f339708f081c52139f06348","observation_id":"3a5694d7-dfcb-4068-a04e-1303187cd1c9","resolution":{"observed_at":"2026-08-12T14:22:40.972138Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2212.08377","last_updated":"2023-02-28T09:00:33Z","snapshot_observed_at":"2026-08-16T21:33:39.567605Z","submitted_at":"2022-12-16T10:05:31Z","title":"PointAvatar: Deformable Point-based Head Avatars from Videos","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2212.08377","snapshot_observed_at":"2026-08-12T14:22:40.987173Z","title":"Black, and Otmar Hilliges","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2411.15436","last_updated":"2024-11-23T03:43:09Z","snapshot_observed_at":"2026-08-14T19:08:23.005879Z","submitted_at":"2024-11-23T03:43:09Z","title":"ConsistentAvatar: Learning to Diffuse Fully Consistent Talking Head Avatar with Temporal Guidance","version":1},"reference_index":48,"source":"pdf_text","source_observed_at":"2026-08-12T14:22:40.987173Z"},"links":{"cited_paper":"/paper/2212.08377","citing_paper":"/paper/2411.15436"},"observation_digest":"sha256:bfd1690d846f87838ec275dd15ec67239aa7d2f579d9ba3dacd975162852ac71","observation_id":"7fc9e0b0-43db-4012-85ac-6160fb8314a3","resolution":{"observed_at":"2026-08-12T14:22:40.987173Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T14:22:41.737292Z","title":"Bühler, Xu Chen, Michael J","venue":null,"work_id":"d58aa567-1ca3-4fbf-b417-0e1ad4843339","year":2022},"citing_paper":{"arxiv_id":"2411.15436","last_updated":"2024-11-23T03:43:09Z","snapshot_observed_at":"2026-08-14T19:08:23.005879Z","submitted_at":"2024-11-23T03:43:09Z","title":"ConsistentAvatar: Learning to Diffuse Fully Consistent Talking Head Avatar with Temporal Guidance","version":1},"reference_index":49,"source":"pdf_text","source_observed_at":"2026-08-12T14:22:40.982248Z"},"links":{"citing_paper":"/paper/2411.15436"},"observation_digest":"sha256:bb74f0db24929c390429fe30e3e922dc7502aa724002e9d93a8bf7a8684e1546","observation_id":"0d4c6001-e695-4e80-8171-9a95486a4e69","resolution":{"observed_at":"2026-08-12T14:22:41.742543Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T14:22:41.720685Z","title":null,"venue":null,"work_id":"b5f70d9f-521e-4c69-b459-bc7ebf815ff8","year":2023},"citing_paper":{"arxiv_id":"2411.15436","last_updated":"2024-11-23T03:43:09Z","snapshot_observed_at":"2026-08-14T19:08:23.005879Z","submitted_at":"2024-11-23T03:43:09Z","title":"ConsistentAvatar: Learning to Diffuse Fully Consistent Talking Head Avatar with Temporal Guidance","version":1},"reference_index":51,"source":"pdf_text","source_observed_at":"2026-08-12T14:22:40.992230Z"},"links":{"citing_paper":"/paper/2411.15436"},"observation_digest":"sha256:ef543a48fa7ffa470471217cf6e59f3925f61596c13502596335c32583c49774","observation_id":"ca912acf-79d7-41f2-b458-0597d14eae2f","resolution":{"observed_at":"2026-08-12T14:22:41.725613Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2206.06481","last_updated":"2022-06-13T21:28:34Z","snapshot_observed_at":"2026-08-19T09:29:50.118251Z","submitted_at":"2022-06-13T21:28:34Z","title":"RigNeRF: Fully Controllable Neural 3D Portraits","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2206.06481","snapshot_observed_at":"2026-08-12T14:22:40.737451Z","title":"arXiv:2206.06481 [cs.CV]","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2411.15436","last_updated":"2024-11-23T03:43:09Z","snapshot_observed_at":"2026-08-14T19:08:23.005879Z","submitted_at":"2024-11-23T03:43:09Z","title":"ConsistentAvatar: Learning to Diffuse Fully Consistent Talking Head Avatar with Temporal Guidance","version":1},"reference_index":2022,"source":"pdf_text","source_observed_at":"2026-08-12T14:22:40.737451Z"},"links":{"cited_paper":"/paper/2206.06481","citing_paper":"/paper/2411.15436"},"observation_digest":"sha256:79d2fb3a01664e87d3152cc76d08aa7471bc968f0a85319678bfc9fdb6f6eb6c","observation_id":"bd666fe0-45f9-4c2d-81f4-a99683d7ba4c","resolution":{"observed_at":"2026-08-12T14:22:40.737451Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"paper":{"arxiv_id":"2411.15436","last_updated":"2024-11-23T03:43:09Z","latest_version":1,"primary_category":"cs.CV","snapshot_observed_at":"2026-08-14T19:08:23.005879Z","submitted_at":"2024-11-23T03:43:09Z","title":"ConsistentAvatar: Learning to Diffuse Fully Consistent Talking Head Avatar with Temporal Guidance"},"reference_resolution":{"displayed":51,"state_counts":{"malformed_identifier":0,"metadata_mismatch":2,"parse_uncertain":0,"unresolved":37,"verified_exact":9,"verified_fuzzy":3},"total_outbound_references":51},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"thesis":"As of 19 August 2026, this Paper Citation Record lists 51 of 51 outbound references and 0 inbound Pith citation observations for arXiv:2411.15436."}