{"as_of":"2026-08-18T01:23:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:af9dc30b3fee7a9c48d59ac3810f8ec73923aa0c380502ec8f3c574fc9733ec9","coverage":[{"denominator":33,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":33,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-05T20:23:52.980432Z","state":"measured"},{"denominator":33,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":33,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-17T06:30:58.91139+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2508.10566/citation-record","integrity":"/paper/2508.10566/integrity","json":"/paper/2508.10566/citation-record.json","paper":"/paper/2508.10566"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T20:23:57.740452Z","title":"Openface 2.0: Facial behavior analysis toolkit","venue":null,"work_id":"37625dda-d29a-4fea-9651-80cf8ae41fcc","year":2018},"citing_paper":{"arxiv_id":"2508.10566","last_updated":"2026-05-25T08:41:59Z","snapshot_observed_at":"2026-08-17T16:38:40.995565Z","submitted_at":"2025-08-14T12:01:52Z","title":"HM-Talker: Hybrid Motion Modeling for High-Fidelity Talking Head Synthesis","version":3},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-05T20:23:50.844471Z"},"links":{"citing_paper":"/paper/2508.10566"},"observation_digest":"sha256:36a5792bdcc89d63860e4887711e2ccf2d54b8865d21c7f5ff579c56c74d30d6","observation_id":"9be8d162-5f1a-48e6-a436-a2526d57a70c","resolution":{"observed_at":"2026-08-05T20:23:57.823532Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T20:23:57.549799Z","title":"A morphable model for the synthesis of 3d faces","venue":null,"work_id":"683f5d10-f06b-4464-a835-22e879369391","year":1999},"citing_paper":{"arxiv_id":"2508.10566","last_updated":"2026-05-25T08:41:59Z","snapshot_observed_at":"2026-08-17T16:38:40.995565Z","submitted_at":"2025-08-14T12:01:52Z","title":"HM-Talker: Hybrid Motion Modeling for High-Fidelity Talking Head Synthesis","version":3},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-05T20:23:50.900701Z"},"links":{"citing_paper":"/paper/2508.10566"},"observation_digest":"sha256:74334ab5b8f2c7db3e81bec74fd5783b9ec89a5edaa6eb1bf2df5c79468c50ab","observation_id":"bfb99bc6-e204-4ec3-aad4-d9259f903570","resolution":{"observed_at":"2026-08-05T20:23:57.646436Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T20:23:57.354028Z","title":"A morphable model for the synthesis of 3d faces","venue":null,"work_id":"6f241ca0-0fb7-4e82-b054-ad072fa5b578","year":2023},"citing_paper":{"arxiv_id":"2508.10566","last_updated":"2026-05-25T08:41:59Z","snapshot_observed_at":"2026-08-17T16:38:40.995565Z","submitted_at":"2025-08-14T12:01:52Z","title":"HM-Talker: Hybrid Motion Modeling for High-Fidelity Talking Head Synthesis","version":3},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-05T20:23:50.953721Z"},"links":{"citing_paper":"/paper/2508.10566"},"observation_digest":"sha256:dbfb9b07eb507430d7f76dade3456822ecd78bbd9097a3de4d694c06cf0fd2ec","observation_id":"51a6349f-d1ed-4f2f-844b-8abc5bb5ab29","resolution":{"observed_at":"2026-08-05T20:23:57.443967Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T20:23:57.206086Z","title":"Lip movements generation at a glance","venue":null,"work_id":"c0382276-854a-4c93-82b4-dc974b6d9838","year":null},"citing_paper":{"arxiv_id":"2508.10566","last_updated":"2026-05-25T08:41:59Z","snapshot_observed_at":"2026-08-17T16:38:40.995565Z","submitted_at":"2025-08-14T12:01:52Z","title":"HM-Talker: Hybrid Motion Modeling for High-Fidelity Talking Head Synthesis","version":3},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-05T20:23:51.029278Z"},"links":{"citing_paper":"/paper/2508.10566"},"observation_digest":"sha256:fa98ec12e9fb99467849505725320dc819cc2973ad5f473d389735b71d6a51f3","observation_id":"2ad98d9a-f983-4a87-9987-b034dd74f716","resolution":{"observed_at":"2026-08-05T20:23:57.275070Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T20:23:56.941852Z","title":"Gaus- siantalker: Real-time high-fidelity talking head synthesis with audio-driven 3d gaussian splatting","venue":null,"work_id":"bb19a360-7c9c-4ee1-b585-ba07cb7a2f5f","year":null},"citing_paper":{"arxiv_id":"2508.10566","last_updated":"2026-05-25T08:41:59Z","snapshot_observed_at":"2026-08-17T16:38:40.995565Z","submitted_at":"2025-08-14T12:01:52Z","title":"HM-Talker: Hybrid Motion Modeling for High-Fidelity Talking Head Synthesis","version":3},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-05T20:23:51.096300Z"},"links":{"citing_paper":"/paper/2508.10566"},"observation_digest":"sha256:04dbcee6ff12ea85817a466d96ca1112332b68c4a186e640dd91a28966220ce9","observation_id":"722b9970-7bc3-4e5c-956f-c8c483b267e0","resolution":{"observed_at":"2026-08-05T20:23:57.104449Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T20:23:56.762787Z","title":"Generalizable and ani- matable gaussian head avatar, 2025","venue":null,"work_id":"31f23bbe-9fc4-406e-93eb-df0405996112","year":2025},"citing_paper":{"arxiv_id":"2508.10566","last_updated":"2026-05-25T08:41:59Z","snapshot_observed_at":"2026-08-17T16:38:40.995565Z","submitted_at":"2025-08-14T12:01:52Z","title":"HM-Talker: Hybrid Motion Modeling for High-Fidelity Talking Head Synthesis","version":3},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-05T20:23:51.156714Z"},"links":{"citing_paper":"/paper/2508.10566"},"observation_digest":"sha256:cf7db1ca15ece5ab4a52dd60d9671221e8f93bb465f7e086505e1d8081eb2099","observation_id":"8ca06bde-a813-400e-81f7-a93e87dbf3d2","resolution":{"observed_at":"2026-08-05T20:23:56.831726Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T20:23:56.613098Z","title":"Lip reading in the wild","venue":null,"work_id":"f1888428-9a4a-48c8-8d3b-e07b77ee652a","year":null},"citing_paper":{"arxiv_id":"2508.10566","last_updated":"2026-05-25T08:41:59Z","snapshot_observed_at":"2026-08-17T16:38:40.995565Z","submitted_at":"2025-08-14T12:01:52Z","title":"HM-Talker: Hybrid Motion Modeling for High-Fidelity Talking Head Synthesis","version":3},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-05T20:23:51.237122Z"},"links":{"citing_paper":"/paper/2508.10566"},"observation_digest":"sha256:dfbcda50e0e49887c10345a88fa51ec06c834a47a691173f4b8ca550b82713c8","observation_id":"f8ae2f6f-fa7d-4da4-bfc4-c247f7652d1a","resolution":{"observed_at":"2026-08-05T20:23:56.657397Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T20:23:56.365452Z","title":"Out of time: auto- mated lip sync in the wild","venue":null,"work_id":"9fa7b517-a7f0-419e-8ffa-e56911dbb85a","year":2017},"citing_paper":{"arxiv_id":"2508.10566","last_updated":"2026-05-25T08:41:59Z","snapshot_observed_at":"2026-08-17T16:38:40.995565Z","submitted_at":"2025-08-14T12:01:52Z","title":"HM-Talker: Hybrid Motion Modeling for High-Fidelity Talking Head Synthesis","version":3},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-05T20:23:51.339790Z"},"links":{"citing_paper":"/paper/2508.10566"},"observation_digest":"sha256:d44faa234cc39ab7a6be91f89cc724b10a0dd4ec322da720422a507ddc32d355","observation_id":"1b24a173-7bdf-49e7-b9cd-3cd07fc5abbd","resolution":{"observed_at":"2026-08-05T20:23:56.456554Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T20:23:56.176948Z","title":"Facial action coding system.Environmental Psychology & Nonverbal Behavior,","venue":null,"work_id":"eb333062-c4f1-4204-a9cc-98245915a945","year":null},"citing_paper":{"arxiv_id":"2508.10566","last_updated":"2026-05-25T08:41:59Z","snapshot_observed_at":"2026-08-17T16:38:40.995565Z","submitted_at":"2025-08-14T12:01:52Z","title":"HM-Talker: Hybrid Motion Modeling for High-Fidelity Talking Head Synthesis","version":3},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-05T20:23:51.394822Z"},"links":{"citing_paper":"/paper/2508.10566"},"observation_digest":"sha256:2003919569d158eba17ee96620af777ca9ef6d1f7ccc7f9f40796fb46697f94e","observation_id":"3fa436dc-cdbe-4de8-b903-1986103aea25","resolution":{"observed_at":"2026-08-05T20:23:56.292634Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T20:23:55.960765Z","title":"Monocular and generalizable gaussian talking head animation","venue":null,"work_id":"54722cba-fe73-4cf6-b41f-56f305448dd3","year":2025},"citing_paper":{"arxiv_id":"2508.10566","last_updated":"2026-05-25T08:41:59Z","snapshot_observed_at":"2026-08-17T16:38:40.995565Z","submitted_at":"2025-08-14T12:01:52Z","title":"HM-Talker: Hybrid Motion Modeling for High-Fidelity Talking Head Synthesis","version":3},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-05T20:23:51.462315Z"},"links":{"citing_paper":"/paper/2508.10566"},"observation_digest":"sha256:4ec2a75dc3df52712548702389d5b72e2b37782b337f0ebda4fdf0cec8685684","observation_id":"4eaebfb2-4baa-44ab-9ab1-b51c96bc8d01","resolution":{"observed_at":"2026-08-05T20:23:56.070403Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T20:23:55.815735Z","title":"Beyond self-attention: External attention using two linear layers for visual tasks.IEEE Transactions on Pattern Analysis and Machine Intelligence, 45(5):5436–5447, 2022","venue":null,"work_id":"7f132d3e-5a12-40c8-b81b-2a713f97f4df","year":2022},"citing_paper":{"arxiv_id":"2508.10566","last_updated":"2026-05-25T08:41:59Z","snapshot_observed_at":"2026-08-17T16:38:40.995565Z","submitted_at":"2025-08-14T12:01:52Z","title":"HM-Talker: Hybrid Motion Modeling for High-Fidelity Talking Head Synthesis","version":3},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-05T20:23:51.557593Z"},"links":{"citing_paper":"/paper/2508.10566"},"observation_digest":"sha256:49a34515ef435fe33d7034ea5a7e071a85832d8a5879d8fbf2eaaa548414fc5b","observation_id":"cbccb63d-f2f0-4937-8ada-b845755e04ec","resolution":{"observed_at":"2026-08-05T20:23:55.899164Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T20:23:55.560458Z","title":"Ad-nerf: Audio driven neural ra- diance fields for talking head synthesis","venue":null,"work_id":"92cb1037-6058-4f19-a367-9569d6b15b11","year":null},"citing_paper":{"arxiv_id":"2508.10566","last_updated":"2026-05-25T08:41:59Z","snapshot_observed_at":"2026-08-17T16:38:40.995565Z","submitted_at":"2025-08-14T12:01:52Z","title":"HM-Talker: Hybrid Motion Modeling for High-Fidelity Talking Head Synthesis","version":3},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-05T20:23:51.614815Z"},"links":{"citing_paper":"/paper/2508.10566"},"observation_digest":"sha256:785d7103bde8464af7d19904c22a5656500191bf377682a9a86f0cb8d82efdf4","observation_id":"be27c7d8-1577-4d6c-b806-c6956d8a671c","resolution":{"observed_at":"2026-08-05T20:23:55.680819Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1412.5567","last_updated":"2014-12-19T21:36:13Z","snapshot_observed_at":"2026-08-14T23:07:07.038301Z","submitted_at":"2014-12-17T20:39:45Z","title":"Deep Speech: Scaling up end-to-end speech recognition","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1412.5567","snapshot_observed_at":"2026-08-05T20:23:51.658851Z","title":"Deep speech: Scaling up end-to-end speech recognition.arXiv preprint arXiv:1412.5567, 2014","venue":null,"work_id":null,"year":2014},"citing_paper":{"arxiv_id":"2508.10566","last_updated":"2026-05-25T08:41:59Z","snapshot_observed_at":"2026-08-17T16:38:40.995565Z","submitted_at":"2025-08-14T12:01:52Z","title":"HM-Talker: Hybrid Motion Modeling for High-Fidelity Talking Head Synthesis","version":3},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-05T20:23:51.658851Z"},"links":{"cited_paper":"/paper/1412.5567","citing_paper":"/paper/2508.10566"},"observation_digest":"sha256:d2b0f061dc80603d68e5854ce44e0fbd2c283bb7d80eaf070a558f7de5bf476a","observation_id":"f4b98128-934c-44e5-b2b2-5a6d7dd6dc0c","resolution":{"observed_at":"2026-08-05T20:23:51.658851Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T20:23:55.344567Z","title":"3d gaussian splatting for real-time radiance field rendering.ACM Transactions on Graphics, 42 (4), 2023","venue":null,"work_id":"05bbf849-26db-471d-bb63-afe5cbf28906","year":2023},"citing_paper":{"arxiv_id":"2508.10566","last_updated":"2026-05-25T08:41:59Z","snapshot_observed_at":"2026-08-17T16:38:40.995565Z","submitted_at":"2025-08-14T12:01:52Z","title":"HM-Talker: Hybrid Motion Modeling for High-Fidelity Talking Head Synthesis","version":3},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-05T20:23:51.740309Z"},"links":{"citing_paper":"/paper/2508.10566"},"observation_digest":"sha256:4ced73ec369d5b523216639c459ec13661de3494686e8200e87e251bc8c285c4","observation_id":"1c4bf9b9-bfe3-47dd-aafb-bca16ae209f8","resolution":{"observed_at":"2026-08-05T20:23:55.459727Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1412.6980","last_updated":"2017-01-30T01:27:54Z","snapshot_observed_at":"2026-08-17T19:26:44.032537Z","submitted_at":"2014-12-22T13:54:29Z","title":"Adam: A Method for Stochastic Optimization","version":9},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1412.6980","snapshot_observed_at":"2026-08-05T20:23:51.834726Z","title":"Adam: A method for stochastic optimization.arXiv preprint arXiv:1412.6980,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2508.10566","last_updated":"2026-05-25T08:41:59Z","snapshot_observed_at":"2026-08-17T16:38:40.995565Z","submitted_at":"2025-08-14T12:01:52Z","title":"HM-Talker: Hybrid Motion Modeling for High-Fidelity Talking Head Synthesis","version":3},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-05T20:23:51.834726Z"},"links":{"cited_paper":"/paper/1412.6980","citing_paper":"/paper/2508.10566"},"observation_digest":"sha256:c551a2170a7bf1b62aef715a144d61156c5894b8df5279aad4ad6fce547a5e54","observation_id":"60dde6c4-38fd-4165-8c5a-1086758e47bf","resolution":{"observed_at":"2026-08-05T20:23:51.834726Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T20:23:55.168315Z","title":null,"venue":null,"work_id":"7174876b-f909-4dbf-bd2d-aeb2964c3db3","year":null},"citing_paper":{"arxiv_id":"2508.10566","last_updated":"2026-05-25T08:41:59Z","snapshot_observed_at":"2026-08-17T16:38:40.995565Z","submitted_at":"2025-08-14T12:01:52Z","title":"HM-Talker: Hybrid Motion Modeling for High-Fidelity Talking Head Synthesis","version":3},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-05T20:23:51.918953Z"},"links":{"citing_paper":"/paper/2508.10566"},"observation_digest":"sha256:c26bc93321d16022f0a36a065ce50bfaec8b64c6998448b1804e97408a9e765b","observation_id":"6aaf3b7f-2bf7-4ca3-91ff-563dbdcac839","resolution":{"observed_at":"2026-08-05T20:23:55.253319Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T20:23:55.027689Z","title":"Ef- ficient region-aware neural radiance fields for high-fidelity talking portrait synthesis","venue":null,"work_id":"23888d35-20f2-4d92-8280-3f215416e43c","year":2023},"citing_paper":{"arxiv_id":"2508.10566","last_updated":"2026-05-25T08:41:59Z","snapshot_observed_at":"2026-08-17T16:38:40.995565Z","submitted_at":"2025-08-14T12:01:52Z","title":"HM-Talker: Hybrid Motion Modeling for High-Fidelity Talking Head Synthesis","version":3},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-05T20:23:51.961010Z"},"links":{"citing_paper":"/paper/2508.10566"},"observation_digest":"sha256:3bc0e2cc0b41bde7d3ad8723618e290ca528ad299f1a77544ed0e3e1d457bff3","observation_id":"ce4a03eb-25ad-42b9-8dbf-2a63420d1b69","resolution":{"observed_at":"2026-08-05T20:23:55.079838Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T20:23:54.832562Z","title":"Talkinggaussian: Structure-persistent 3d talking head synthesis via gaussian splatting","venue":null,"work_id":"6c5d5d49-64d8-43a1-b305-855f19c1e575","year":2025},"citing_paper":{"arxiv_id":"2508.10566","last_updated":"2026-05-25T08:41:59Z","snapshot_observed_at":"2026-08-17T16:38:40.995565Z","submitted_at":"2025-08-14T12:01:52Z","title":"HM-Talker: Hybrid Motion Modeling for High-Fidelity Talking Head Synthesis","version":3},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-05T20:23:52.025486Z"},"links":{"citing_paper":"/paper/2508.10566"},"observation_digest":"sha256:7b52fd6cd2334d199bb2ac8053fa604b0f995ba3ca389420b2793ed8cadcc21d","observation_id":"5f6a9738-8966-451a-a28c-b1b31bdcf5a1","resolution":{"observed_at":"2026-08-05T20:23:54.922441Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T20:23:54.649754Z","title":"Instag: Learning personalized 3d talking head from few-second video","venue":null,"work_id":"6dcea0a9-2c8e-47f6-814d-239e723e5c52","year":2025},"citing_paper":{"arxiv_id":"2508.10566","last_updated":"2026-05-25T08:41:59Z","snapshot_observed_at":"2026-08-17T16:38:40.995565Z","submitted_at":"2025-08-14T12:01:52Z","title":"HM-Talker: Hybrid Motion Modeling for High-Fidelity Talking Head Synthesis","version":3},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-05T20:23:52.094160Z"},"links":{"citing_paper":"/paper/2508.10566"},"observation_digest":"sha256:309a419ed69163735267330865a1e4fd66fb42c038cbc31bcc9cee7096024974","observation_id":"8f245418-631d-4205-a9a9-d1b9d485dc96","resolution":{"observed_at":"2026-08-05T20:23:54.725824Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T20:23:52.159983Z","title":"Decoupled weight de- cay regularization","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2508.10566","last_updated":"2026-05-25T08:41:59Z","snapshot_observed_at":"2026-08-17T16:38:40.995565Z","submitted_at":"2025-08-14T12:01:52Z","title":"HM-Talker: Hybrid Motion Modeling for High-Fidelity Talking Head Synthesis","version":3},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-05T20:23:52.159983Z"},"links":{"citing_paper":"/paper/2508.10566"},"observation_digest":"sha256:e6bd74681c7190ddb4797960f9269750046f9bdf0262a3abc290748ebd4071e0","observation_id":"911c665e-52a4-4b84-b467-439c5306a771","resolution":{"observed_at":"2026-08-05T20:23:52.159983Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T20:23:52.214274Z","title":"Nerf: Representing scenes as neural radiance fields for view syn- thesis.Communications of the ACM, 65(1):99–106, 2021","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2508.10566","last_updated":"2026-05-25T08:41:59Z","snapshot_observed_at":"2026-08-17T16:38:40.995565Z","submitted_at":"2025-08-14T12:01:52Z","title":"HM-Talker: Hybrid Motion Modeling for High-Fidelity Talking Head Synthesis","version":3},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-05T20:23:52.214274Z"},"links":{"citing_paper":"/paper/2508.10566"},"observation_digest":"sha256:156994d2cc61bd123726847095462f52cf7ff43e2730fe7b28891d591b570c44","observation_id":"921af4c2-181f-410e-b2ee-4eaaf47a5ee2","resolution":{"observed_at":"2026-08-05T20:23:52.214274Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T20:23:54.439511Z","title":"Synctalk: The devil is in the synchronization for talking head synthesis","venue":null,"work_id":"bf128270-e88c-4633-b8d5-c690f55c02b9","year":2024},"citing_paper":{"arxiv_id":"2508.10566","last_updated":"2026-05-25T08:41:59Z","snapshot_observed_at":"2026-08-17T16:38:40.995565Z","submitted_at":"2025-08-14T12:01:52Z","title":"HM-Talker: Hybrid Motion Modeling for High-Fidelity Talking Head Synthesis","version":3},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-05T20:23:52.280660Z"},"links":{"citing_paper":"/paper/2508.10566"},"observation_digest":"sha256:cc2f461ac4ab309d0c8faba537d8dbf57db0c020053f9630305b907610a6e902","observation_id":"2140df8f-5e69-42f3-a18c-aaaa550926c4","resolution":{"observed_at":"2026-08-05T20:23:54.550024Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T20:23:54.280736Z","title":"A lip sync expert is all you need for speech to lip generation in the wild","venue":null,"work_id":"3dd4323f-4844-477f-937d-07506b6481a8","year":2020},"citing_paper":{"arxiv_id":"2508.10566","last_updated":"2026-05-25T08:41:59Z","snapshot_observed_at":"2026-08-17T16:38:40.995565Z","submitted_at":"2025-08-14T12:01:52Z","title":"HM-Talker: Hybrid Motion Modeling for High-Fidelity Talking Head Synthesis","version":3},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-05T20:23:52.338864Z"},"links":{"citing_paper":"/paper/2508.10566"},"observation_digest":"sha256:616c4fedcaf4cd3a45b23d1111e7e7b209e6cd40ee5c36f23f2cf62b53960cd9","observation_id":"8109fb47-85af-4506-bdf1-7b5b10e83fc4","resolution":{"observed_at":"2026-08-05T20:23:54.360498Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T20:23:54.132417Z","title":"Facial action coding system.Environmental Psychology & Nonverbal Behavior, 1, 2015","venue":null,"work_id":"82a89ebf-86d4-4bc8-9052-1ad7c6c4cfde","year":2015},"citing_paper":{"arxiv_id":"2508.10566","last_updated":"2026-05-25T08:41:59Z","snapshot_observed_at":"2026-08-17T16:38:40.995565Z","submitted_at":"2025-08-14T12:01:52Z","title":"HM-Talker: Hybrid Motion Modeling for High-Fidelity Talking Head Synthesis","version":3},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-05T20:23:52.424634Z"},"links":{"citing_paper":"/paper/2508.10566"},"observation_digest":"sha256:921ef5b676e2b29e165a78ba1c4b702364c85dbc84da2982606b79a6c1835c8d","observation_id":"db031e85-a59a-4858-aa38-6cda160e7abb","resolution":{"observed_at":"2026-08-05T20:23:54.213839Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2211.12368","last_updated":"2022-11-22T16:03:11Z","snapshot_observed_at":"2026-08-17T16:38:11.327285Z","submitted_at":"2022-11-22T16:03:11Z","title":"Real-time Neural Radiance Talking Portrait Synthesis via Audio-spatial Decomposition","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2211.12368","snapshot_observed_at":"2026-08-05T20:23:52.498086Z","title":"Real-time neural radiance talking portrait synthesis via audio-spatial decomposition.arXiv preprint arXiv:2211.12368, 2022","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2508.10566","last_updated":"2026-05-25T08:41:59Z","snapshot_observed_at":"2026-08-17T16:38:40.995565Z","submitted_at":"2025-08-14T12:01:52Z","title":"HM-Talker: Hybrid Motion Modeling for High-Fidelity Talking Head Synthesis","version":3},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-08-05T20:23:52.498086Z"},"links":{"cited_paper":"/paper/2211.12368","citing_paper":"/paper/2508.10566"},"observation_digest":"sha256:e51a316e54f8e5abfbb6f9124f03426ab41100ef43d2bdafa70b337cd872ac0c","observation_id":"19b8ed82-0855-4c3a-8b3f-95ad11660669","resolution":{"observed_at":"2026-08-05T20:23:52.498086Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T20:23:54.017360Z","title":"Seeing what you said: Talking face genera- tion guided by a lip reading expert","venue":null,"work_id":"4d77511e-0f4d-448a-83f1-93c7cae30b62","year":2023},"citing_paper":{"arxiv_id":"2508.10566","last_updated":"2026-05-25T08:41:59Z","snapshot_observed_at":"2026-08-17T16:38:40.995565Z","submitted_at":"2025-08-14T12:01:52Z","title":"HM-Talker: Hybrid Motion Modeling for High-Fidelity Talking Head Synthesis","version":3},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-08-05T20:23:52.556214Z"},"links":{"citing_paper":"/paper/2508.10566"},"observation_digest":"sha256:3e57096d0582deb1bfff2a39fa59ac2c6cc879fc7c0f78a1840b7ed7bd22fbf5","observation_id":"ee1803ff-5773-4f6b-acc9-daccfd91cf29","resolution":{"observed_at":"2026-08-05T20:23:54.070994Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T20:23:53.840006Z","title":"Image quality assessment: from error visibility to structural similarity.IEEE Transactions on Image Process- ing, 13(4):600–612, 2004","venue":null,"work_id":"06b6430a-2fa2-4e6a-9544-72958949d185","year":2004},"citing_paper":{"arxiv_id":"2508.10566","last_updated":"2026-05-25T08:41:59Z","snapshot_observed_at":"2026-08-17T16:38:40.995565Z","submitted_at":"2025-08-14T12:01:52Z","title":"HM-Talker: Hybrid Motion Modeling for High-Fidelity Talking Head Synthesis","version":3},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-08-05T20:23:52.650641Z"},"links":{"citing_paper":"/paper/2508.10566"},"observation_digest":"sha256:49f4e4716583575d6cbfab389fde4fa1be41d954894a3ec682e9f5775d780bfe","observation_id":"fb0bd39b-06cb-4e10-8f81-26429e6ae4fa","resolution":{"observed_at":"2026-08-05T20:23:53.916238Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T20:23:53.692506Z","title":"Geneface: Generalized and high-fidelity audio-driven 3d talking face synthesis","venue":null,"work_id":"dbc4cb86-8552-4e78-9269-e17a69aead5c","year":2023},"citing_paper":{"arxiv_id":"2508.10566","last_updated":"2026-05-25T08:41:59Z","snapshot_observed_at":"2026-08-17T16:38:40.995565Z","submitted_at":"2025-08-14T12:01:52Z","title":"HM-Talker: Hybrid Motion Modeling for High-Fidelity Talking Head Synthesis","version":3},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-08-05T20:23:52.706624Z"},"links":{"citing_paper":"/paper/2508.10566"},"observation_digest":"sha256:27b8345f65f2960b7e147b08a1ae582d2ef876557d57a373d3a917b7a4ec10af","observation_id":"8f189a74-9219-4d6b-b466-c10873dfc34d","resolution":{"observed_at":"2026-08-05T20:23:53.744748Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T20:23:53.534213Z","title":"The unreasonable effectiveness of deep features as a perceptual metric","venue":null,"work_id":"f960f37c-658d-4698-9b71-762efc26a421","year":null},"citing_paper":{"arxiv_id":"2508.10566","last_updated":"2026-05-25T08:41:59Z","snapshot_observed_at":"2026-08-17T16:38:40.995565Z","submitted_at":"2025-08-14T12:01:52Z","title":"HM-Talker: Hybrid Motion Modeling for High-Fidelity Talking Head Synthesis","version":3},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-08-05T20:23:52.775081Z"},"links":{"citing_paper":"/paper/2508.10566"},"observation_digest":"sha256:bf99eee23088b368955a6e55eb0a9445d264bac9aacffa89fece3e58e1745807","observation_id":"e61bd745-e9a1-45d3-ac4a-4362c9d07ae3","resolution":{"observed_at":"2026-08-05T20:23:53.593170Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T20:23:53.375393Z","title":"Sadtalker: Learning realistic 3d motion coefficients for stylized audio- driven single image talking face animation","venue":null,"work_id":"ca798f38-7ce4-41c7-bd0b-9d4bcd8128bf","year":null},"citing_paper":{"arxiv_id":"2508.10566","last_updated":"2026-05-25T08:41:59Z","snapshot_observed_at":"2026-08-17T16:38:40.995565Z","submitted_at":"2025-08-14T12:01:52Z","title":"HM-Talker: Hybrid Motion Modeling for High-Fidelity Talking Head Synthesis","version":3},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-08-05T20:23:52.836382Z"},"links":{"citing_paper":"/paper/2508.10566"},"observation_digest":"sha256:d96f6852bccebeec98b7af2903fc92806c340a4886bd28f47e54863ac9689c08","observation_id":"82fe8876-c3b4-4530-abc9-11bd8f3cc70f","resolution":{"observed_at":"2026-08-05T20:23:53.442457Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T20:23:53.224632Z","title":"Dinet: Deformation inpainting network for realistic face visually dubbing on high resolution video","venue":null,"work_id":"25f0c387-b3bd-4caf-9f90-cec5674f1790","year":2023},"citing_paper":{"arxiv_id":"2508.10566","last_updated":"2026-05-25T08:41:59Z","snapshot_observed_at":"2026-08-17T16:38:40.995565Z","submitted_at":"2025-08-14T12:01:52Z","title":"HM-Talker: Hybrid Motion Modeling for High-Fidelity Talking Head Synthesis","version":3},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-08-05T20:23:52.914598Z"},"links":{"citing_paper":"/paper/2508.10566"},"observation_digest":"sha256:9a9637fab655eca971f19c7696aeb340a4ce50e506bda613af9bad2ebd925697","observation_id":"3f9f2f41-0c00-4995-a103-8103cd4fcc55","resolution":{"observed_at":"2026-08-05T20:23:53.303808Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T20:23:53.072119Z","title":"Identity- preserving talking face generation with landmark and ap- pearance priors","venue":null,"work_id":"f040166c-8e6e-4465-8af6-870985c55125","year":2023},"citing_paper":{"arxiv_id":"2508.10566","last_updated":"2026-05-25T08:41:59Z","snapshot_observed_at":"2026-08-17T16:38:40.995565Z","submitted_at":"2025-08-14T12:01:52Z","title":"HM-Talker: Hybrid Motion Modeling for High-Fidelity Talking Head Synthesis","version":3},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-08-05T20:23:52.980432Z"},"links":{"citing_paper":"/paper/2508.10566"},"observation_digest":"sha256:ac1019390f913982e17f4095f8980cebf456394667c2f91dbefc5d6a0de52db9","observation_id":"5cf28392-1eb7-408b-b578-0865d088a583","resolution":{"observed_at":"2026-08-05T20:23:53.146284Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T20:23:56.519972Z","title":null,"venue":null,"work_id":"5ab346b1-760c-45c2-ba97-b2332e199011","year":2017},"citing_paper":{"arxiv_id":"2508.10566","last_updated":"2026-05-25T08:41:59Z","snapshot_observed_at":"2026-08-17T16:38:40.995565Z","submitted_at":"2025-08-14T12:01:52Z","title":"HM-Talker: Hybrid Motion Modeling for High-Fidelity Talking Head Synthesis","version":3},"reference_index":103,"source":"pdf_text","source_observed_at":"2026-08-05T20:23:51.285642Z"},"links":{"citing_paper":"/paper/2508.10566"},"observation_digest":"sha256:692c943d7b5be57811c074fe7df9e37a9767fd585cdb8c01fa1b79bcfc9faa23","observation_id":"34d2b8bb-59ec-46d4-9028-3eb00fb98ebf","resolution":{"observed_at":"2026-08-05T20:23:56.608009Z","resolver_source":"raw_fallback","status":"parse_uncertain"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}}],"paper":{"arxiv_id":"2508.10566","last_updated":"2026-05-25T08:41:59Z","latest_version":3,"primary_category":"cs.CV","snapshot_observed_at":"2026-08-17T16:38:40.995565Z","submitted_at":"2025-08-14T12:01:52Z","title":"HM-Talker: Hybrid Motion Modeling for High-Fidelity Talking Head Synthesis"},"reference_resolution":{"displayed":33,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":1,"unresolved":6,"verified_exact":0,"verified_fuzzy":26},"total_outbound_references":33},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"thesis":"As of 18 August 2026, this Paper Citation Record lists 33 of 33 outbound references and 0 inbound Pith citation observations for arXiv:2508.10566."}