{"as_of":"2026-08-20T23:59:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:13737156b86e06560a996fcb86f6229ed7a9550b45fb7f41da0cac55260eb225","coverage":[{"denominator":48,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":48,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-06T05:05:49.574658Z","state":"measured"},{"denominator":49,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":49,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-20T06:33:59.587034+00:00","state":"measured"},{"denominator":1,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":1,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-04T01:03:12.541365Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2508.02362","last_updated":"2025-08-04T12:50:22Z","snapshot_observed_at":"2026-08-17T09:18:20.700203Z","submitted_at":"2025-08-04T12:50:22Z","title":"Text2Lip: Progressive Lip-Synced Talking Face Generation from Text via Viseme-Guided Rendering","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2508.02362","snapshot_observed_at":"2026-08-04T01:03:12.541365Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2608.00663","last_updated":"2026-08-01T13:33:38Z","snapshot_observed_at":"2026-08-13T10:08:04.572404Z","submitted_at":"2026-08-01T13:33:38Z","title":"Geometry-guided Emotion Modulation for Controllable and Photorealistic Emotional Talking Face Generation","version":1},"reference_index":41,"source":"pdf_text","source_observed_at":"2026-08-04T01:03:12.541365Z"},"links":{"cited_paper":"/paper/2508.02362","citing_paper":"/paper/2608.00663"},"observation_digest":"sha256:de2eb69e5a271c729e2a09a73cec895ff17da7b143b3aa23fe072f357f2d2e76","observation_id":"3a1f83e5-6b10-4398-adbf-713461c71e28","resolution":{"observed_at":"2026-08-04T01:03:12.541365Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"links":{"evidence":"/evidence","html":"/paper/2508.02362/citation-record","integrity":"/paper/2508.02362/integrity","json":"/paper/2508.02362/citation-record.json","paper":"/paper/2508.02362"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T05:05:45.643845Z","title":", \" * write output.state after.block = add.period write newline","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2508.02362","last_updated":"2025-08-04T12:50:22Z","snapshot_observed_at":"2026-08-17T09:18:20.700203Z","submitted_at":"2025-08-04T12:50:22Z","title":"Text2Lip: Progressive Lip-Synced Talking Face Generation from Text via Viseme-Guided Rendering","version":1},"reference_index":1,"source":"arxiv_source","source_observed_at":"2026-08-06T05:05:45.643845Z"},"links":{"citing_paper":"/paper/2508.02362"},"observation_digest":"sha256:57d70d1f41bd93eceed6395e88cdb0888fcaff6f1fa17239508e38e9c09d2a9a","observation_id":"7d72292e-c71f-42e3-8867-4c64830db6ca","resolution":{"observed_at":"2026-08-06T05:05:45.643845Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T05:05:45.741115Z","title":"write newline","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2508.02362","last_updated":"2025-08-04T12:50:22Z","snapshot_observed_at":"2026-08-17T09:18:20.700203Z","submitted_at":"2025-08-04T12:50:22Z","title":"Text2Lip: Progressive Lip-Synced Talking Face Generation from Text via Viseme-Guided Rendering","version":1},"reference_index":2,"source":"arxiv_source","source_observed_at":"2026-08-06T05:05:45.741115Z"},"links":{"citing_paper":"/paper/2508.02362"},"observation_digest":"sha256:1210723d06472d05ad4aa4601e1816d6e1808c37c6ed184ba3e7965c1fe258fd","observation_id":"df36c3ee-7c60-4b2f-ac94-967d6b88f571","resolution":{"observed_at":"2026-08-06T05:05:45.741115Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1611.01599","last_updated":"2016-12-16T16:09:34Z","snapshot_observed_at":"2026-08-19T05:41:15.283549Z","submitted_at":"2016-11-05T04:05:18Z","title":"LipNet: End-to-End Sentence-level Lipreading","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1611.01599","snapshot_observed_at":"2026-08-06T05:05:45.830265Z","title":"M.; Shillingford, B.; Whiteson, S.; and De Freitas, N","venue":null,"work_id":null,"year":2016},"citing_paper":{"arxiv_id":"2508.02362","last_updated":"2025-08-04T12:50:22Z","snapshot_observed_at":"2026-08-17T09:18:20.700203Z","submitted_at":"2025-08-04T12:50:22Z","title":"Text2Lip: Progressive Lip-Synced Talking Face Generation from Text via Viseme-Guided Rendering","version":1},"reference_index":3,"source":"arxiv_source","source_observed_at":"2026-08-06T05:05:45.830265Z"},"links":{"cited_paper":"/paper/1611.01599","citing_paper":"/paper/2508.02362"},"observation_digest":"sha256:66a9d63277129e566bda24a3c095664f6dfdc984a96ef964cc0663709359e4f3","observation_id":"f397a45c-2559-45f6-a8c3-822a3387d826","resolution":{"observed_at":"2026-08-06T05:05:45.830265Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T05:05:53.273933Z","title":"C.; Hadfield, S.; Koller, O.; Ney, H.; and Bowden, R","venue":null,"work_id":"57622808-ec24-492b-a19a-01dfa305f3cb","year":2018},"citing_paper":{"arxiv_id":"2508.02362","last_updated":"2025-08-04T12:50:22Z","snapshot_observed_at":"2026-08-17T09:18:20.700203Z","submitted_at":"2025-08-04T12:50:22Z","title":"Text2Lip: Progressive Lip-Synced Talking Face Generation from Text via Viseme-Guided Rendering","version":1},"reference_index":4,"source":"arxiv_source","source_observed_at":"2026-08-06T05:05:45.921604Z"},"links":{"citing_paper":"/paper/2508.02362"},"observation_digest":"sha256:fad9d8744356144210603c2ff8b2d261a29903794bd376b51b2d9c01d0b7a0ce","observation_id":"149f7cc7-45e7-4161-bf65-8f1b8e2b5efd","resolution":{"observed_at":"2026-08-06T05:05:53.421223Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T05:05:52.993513Z","title":null,"venue":null,"work_id":"13795919-36ee-40ce-a200-c38ee5ff01b2","year":2001},"citing_paper":{"arxiv_id":"2508.02362","last_updated":"2025-08-04T12:50:22Z","snapshot_observed_at":"2026-08-17T09:18:20.700203Z","submitted_at":"2025-08-04T12:50:22Z","title":"Text2Lip: Progressive Lip-Synced Talking Face Generation from Text via Viseme-Guided Rendering","version":1},"reference_index":5,"source":"arxiv_source","source_observed_at":"2026-08-06T05:05:46.090636Z"},"links":{"citing_paper":"/paper/2508.02362"},"observation_digest":"sha256:ac68aca101b275f4731aef621bae71261fec6b323024b58d48e5d81bcb276b7d","observation_id":"96d59777-7d1b-46f0-94c0-463f19e776b4","resolution":{"observed_at":"2026-08-06T05:05:53.142032Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T05:05:52.717354Z","title":null,"venue":null,"work_id":"b4a8c549-d6cf-43d1-98e1-8653f42bf619","year":2025},"citing_paper":{"arxiv_id":"2508.02362","last_updated":"2025-08-04T12:50:22Z","snapshot_observed_at":"2026-08-17T09:18:20.700203Z","submitted_at":"2025-08-04T12:50:22Z","title":"Text2Lip: Progressive Lip-Synced Talking Face Generation from Text via Viseme-Guided Rendering","version":1},"reference_index":6,"source":"arxiv_source","source_observed_at":"2026-08-06T05:05:46.226977Z"},"links":{"citing_paper":"/paper/2508.02362"},"observation_digest":"sha256:d539fc1ab35a4ba935ef95150f0035e5a65737488632331a4b85ae2c889c9ef0","observation_id":"1703e9f4-e954-48a1-b4cf-3a34980f1b3b","resolution":{"observed_at":"2026-08-06T05:05:52.863268Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T05:05:52.416114Z","title":"S.; and Zisserman, A","venue":null,"work_id":"27bbe0a7-3efa-4888-a95c-17e40a574176","year":2016},"citing_paper":{"arxiv_id":"2508.02362","last_updated":"2025-08-04T12:50:22Z","snapshot_observed_at":"2026-08-17T09:18:20.700203Z","submitted_at":"2025-08-04T12:50:22Z","title":"Text2Lip: Progressive Lip-Synced Talking Face Generation from Text via Viseme-Guided Rendering","version":1},"reference_index":7,"source":"arxiv_source","source_observed_at":"2026-08-06T05:05:46.346820Z"},"links":{"citing_paper":"/paper/2508.02362"},"observation_digest":"sha256:9715ef353b1a4fced471f44cae98c3615db17324c1aa3e4f9b2052413b417462","observation_id":"a2baeea3-0d2e-4a7a-9c45-67df947b1382","resolution":{"observed_at":"2026-08-06T05:05:52.559920Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T05:05:52.191471Z","title":null,"venue":null,"work_id":"0ef41cae-71a0-41db-b38c-f39be7ac9fdc","year":2006},"citing_paper":{"arxiv_id":"2508.02362","last_updated":"2025-08-04T12:50:22Z","snapshot_observed_at":"2026-08-17T09:18:20.700203Z","submitted_at":"2025-08-04T12:50:22Z","title":"Text2Lip: Progressive Lip-Synced Talking Face Generation from Text via Viseme-Guided Rendering","version":1},"reference_index":8,"source":"arxiv_source","source_observed_at":"2026-08-06T05:05:46.475797Z"},"links":{"citing_paper":"/paper/2508.02362"},"observation_digest":"sha256:996de7855d75892317df77bc9e70c72b143908690ef38530c7f8949c5043424d","observation_id":"4b61fd68-75c6-43c5-9c3a-e8e7c1f9facf","resolution":{"observed_at":"2026-08-06T05:05:52.283030Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T05:05:52.067500Z","title":null,"venue":null,"work_id":"31d644fa-a053-4552-8922-94c1d4a939fa","year":2025},"citing_paper":{"arxiv_id":"2508.02362","last_updated":"2025-08-04T12:50:22Z","snapshot_observed_at":"2026-08-17T09:18:20.700203Z","submitted_at":"2025-08-04T12:50:22Z","title":"Text2Lip: Progressive Lip-Synced Talking Face Generation from Text via Viseme-Guided Rendering","version":1},"reference_index":9,"source":"arxiv_source","source_observed_at":"2026-08-06T05:05:46.563175Z"},"links":{"citing_paper":"/paper/2508.02362"},"observation_digest":"sha256:c558bb5ceab93c6523184bbb7b9c95ea9e12916047b47752f9a2fb4f9e965ec1","observation_id":"5f780a9f-b3d4-4a57-999d-9602991453a9","resolution":{"observed_at":"2026-08-06T05:05:52.109532Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T05:05:52.027861Z","title":null,"venue":null,"work_id":"10f3646d-c42c-41cb-b995-061fecf25702","year":2025},"citing_paper":{"arxiv_id":"2508.02362","last_updated":"2025-08-04T12:50:22Z","snapshot_observed_at":"2026-08-17T09:18:20.700203Z","submitted_at":"2025-08-04T12:50:22Z","title":"Text2Lip: Progressive Lip-Synced Talking Face Generation from Text via Viseme-Guided Rendering","version":1},"reference_index":10,"source":"arxiv_source","source_observed_at":"2026-08-06T05:05:46.617510Z"},"links":{"citing_paper":"/paper/2508.02362"},"observation_digest":"sha256:99e25ee16cf3236feea79378cd0e2181d1942df49222466b8abcc5ec7710c37d","observation_id":"2061122b-87be-4593-91be-456d4c6ed073","resolution":{"observed_at":"2026-08-06T05:05:52.063037Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T05:05:51.886750Z","title":null,"venue":null,"work_id":"67ca0599-cf94-4a65-818a-b98a4564b074","year":2021},"citing_paper":{"arxiv_id":"2508.02362","last_updated":"2025-08-04T12:50:22Z","snapshot_observed_at":"2026-08-17T09:18:20.700203Z","submitted_at":"2025-08-04T12:50:22Z","title":"Text2Lip: Progressive Lip-Synced Talking Face Generation from Text via Viseme-Guided Rendering","version":1},"reference_index":11,"source":"arxiv_source","source_observed_at":"2026-08-06T05:05:46.750333Z"},"links":{"citing_paper":"/paper/2508.02362"},"observation_digest":"sha256:2cea2177c70c62f842edf23b45e1e07283a42cac2b1a7a91087c08d68dff9a59","observation_id":"1080c2e4-de9e-4a71-b170-7dc09d87f22a","resolution":{"observed_at":"2026-08-06T05:05:51.937722Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T05:05:46.829926Z","title":null,"venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2508.02362","last_updated":"2025-08-04T12:50:22Z","snapshot_observed_at":"2026-08-17T09:18:20.700203Z","submitted_at":"2025-08-04T12:50:22Z","title":"Text2Lip: Progressive Lip-Synced Talking Face Generation from Text via Viseme-Guided Rendering","version":1},"reference_index":12,"source":"arxiv_source","source_observed_at":"2026-08-06T05:05:46.829926Z"},"links":{"citing_paper":"/paper/2508.02362"},"observation_digest":"sha256:b9475d6b5d71dcaedaae71b7e3d5d0ae21dc90faa669d3a1e8ce4be938f6ba1f","observation_id":"755109c0-71a0-452f-82f1-93112a3b1591","resolution":{"observed_at":"2026-08-06T05:05:46.829926Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T05:05:46.887710Z","title":null,"venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2508.02362","last_updated":"2025-08-04T12:50:22Z","snapshot_observed_at":"2026-08-17T09:18:20.700203Z","submitted_at":"2025-08-04T12:50:22Z","title":"Text2Lip: Progressive Lip-Synced Talking Face Generation from Text via Viseme-Guided Rendering","version":1},"reference_index":13,"source":"arxiv_source","source_observed_at":"2026-08-06T05:05:46.887710Z"},"links":{"citing_paper":"/paper/2508.02362"},"observation_digest":"sha256:9cd589fd7ba7400ebaa5a2c1483c62e0f468bacd692eced641ae07ece9a043c6","observation_id":"7199c796-aa7c-41cc-8e11-6b6a06e5fd61","resolution":{"observed_at":"2026-08-06T05:05:46.887710Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T05:05:46.942986Z","title":null,"venue":null,"work_id":null,"year":2010},"citing_paper":{"arxiv_id":"2508.02362","last_updated":"2025-08-04T12:50:22Z","snapshot_observed_at":"2026-08-17T09:18:20.700203Z","submitted_at":"2025-08-04T12:50:22Z","title":"Text2Lip: Progressive Lip-Synced Talking Face Generation from Text via Viseme-Guided Rendering","version":1},"reference_index":14,"source":"arxiv_source","source_observed_at":"2026-08-06T05:05:46.942986Z"},"links":{"citing_paper":"/paper/2508.02362"},"observation_digest":"sha256:b54b0ca95d02e92cec74167293a38f240bbda501db8c46f78faf4daa1467e308","observation_id":"29788228-ca64-4e3f-83f3-99f5169e26a4","resolution":{"observed_at":"2026-08-06T05:05:46.942986Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T05:05:51.716786Z","title":null,"venue":null,"work_id":"33558ee8-76c0-4d98-82ea-1e886bf31816","year":2016},"citing_paper":{"arxiv_id":"2508.02362","last_updated":"2025-08-04T12:50:22Z","snapshot_observed_at":"2026-08-17T09:18:20.700203Z","submitted_at":"2025-08-04T12:50:22Z","title":"Text2Lip: Progressive Lip-Synced Talking Face Generation from Text via Viseme-Guided Rendering","version":1},"reference_index":15,"source":"arxiv_source","source_observed_at":"2026-08-06T05:05:46.999437Z"},"links":{"citing_paper":"/paper/2508.02362"},"observation_digest":"sha256:45b1ea56e780a87feb501de03e33d7aa02ad407ad3d6de19253d10f938e216fc","observation_id":"ab1f1bfc-de23-46ea-8c78-27811b5ce9fb","resolution":{"observed_at":"2026-08-06T05:05:51.794759Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T05:05:51.578074Z","title":null,"venue":null,"work_id":"0aa264de-8848-4057-aab6-105328ee5263","year":2013},"citing_paper":{"arxiv_id":"2508.02362","last_updated":"2025-08-04T12:50:22Z","snapshot_observed_at":"2026-08-17T09:18:20.700203Z","submitted_at":"2025-08-04T12:50:22Z","title":"Text2Lip: Progressive Lip-Synced Talking Face Generation from Text via Viseme-Guided Rendering","version":1},"reference_index":16,"source":"arxiv_source","source_observed_at":"2026-08-06T05:05:47.079796Z"},"links":{"citing_paper":"/paper/2508.02362"},"observation_digest":"sha256:7247a1288f3df9ffae5358feb23c11cfb334ab956090c03429b185904e30fb27","observation_id":"b851e62b-589e-49fd-a615-0d50f601e9d9","resolution":{"observed_at":"2026-08-06T05:05:51.632829Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T05:05:47.205288Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2508.02362","last_updated":"2025-08-04T12:50:22Z","snapshot_observed_at":"2026-08-17T09:18:20.700203Z","submitted_at":"2025-08-04T12:50:22Z","title":"Text2Lip: Progressive Lip-Synced Talking Face Generation from Text via Viseme-Guided Rendering","version":1},"reference_index":17,"source":"arxiv_source","source_observed_at":"2026-08-06T05:05:47.205288Z"},"links":{"citing_paper":"/paper/2508.02362"},"observation_digest":"sha256:04e834238a36c24d29e66795d203e79e2ef735a8921adca965fe0e5287918276","observation_id":"e625647d-0499-46e6-b7f8-e1743162bb6f","resolution":{"observed_at":"2026-08-06T05:05:47.205288Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T05:05:51.375483Z","title":null,"venue":null,"work_id":"738d157e-a068-4a7e-8f8e-37671b2c8b12","year":2022},"citing_paper":{"arxiv_id":"2508.02362","last_updated":"2025-08-04T12:50:22Z","snapshot_observed_at":"2026-08-17T09:18:20.700203Z","submitted_at":"2025-08-04T12:50:22Z","title":"Text2Lip: Progressive Lip-Synced Talking Face Generation from Text via Viseme-Guided Rendering","version":1},"reference_index":18,"source":"arxiv_source","source_observed_at":"2026-08-06T05:05:47.246297Z"},"links":{"citing_paper":"/paper/2508.02362"},"observation_digest":"sha256:b4e6b68c48e53addabdb3607b69df286cf8b40431992a046b6336741ccc1316a","observation_id":"dbee3c49-393f-4533-94c9-c18ef502c3db","resolution":{"observed_at":"2026-08-06T05:05:51.447229Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T05:05:47.311050Z","title":null,"venue":null,"work_id":null,"year":2014},"citing_paper":{"arxiv_id":"2508.02362","last_updated":"2025-08-04T12:50:22Z","snapshot_observed_at":"2026-08-17T09:18:20.700203Z","submitted_at":"2025-08-04T12:50:22Z","title":"Text2Lip: Progressive Lip-Synced Talking Face Generation from Text via Viseme-Guided Rendering","version":1},"reference_index":19,"source":"arxiv_source","source_observed_at":"2026-08-06T05:05:47.311050Z"},"links":{"citing_paper":"/paper/2508.02362"},"observation_digest":"sha256:84a15dddabb39e8dd432037f6feb1b3c0e35e4e0849e944e80118ec9bbd098e3","observation_id":"15865a22-4c53-4c14-8b4f-3a5a9bd05447","resolution":{"observed_at":"2026-08-06T05:05:47.311050Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T05:05:47.387033Z","title":null,"venue":null,"work_id":null,"year":2004},"citing_paper":{"arxiv_id":"2508.02362","last_updated":"2025-08-04T12:50:22Z","snapshot_observed_at":"2026-08-17T09:18:20.700203Z","submitted_at":"2025-08-04T12:50:22Z","title":"Text2Lip: Progressive Lip-Synced Talking Face Generation from Text via Viseme-Guided Rendering","version":1},"reference_index":20,"source":"arxiv_source","source_observed_at":"2026-08-06T05:05:47.387033Z"},"links":{"citing_paper":"/paper/2508.02362"},"observation_digest":"sha256:eed58fdf197dc6bb34a483a24e339d81ef89fb0838e9070dda9b991042265405","observation_id":"64353405-f9ad-41aa-97a1-8558aac6894d","resolution":{"observed_at":"2026-08-06T05:05:47.387033Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T05:05:51.251494Z","title":null,"venue":null,"work_id":"095477a4-ac44-40a1-9ac7-682e334d0963","year":2008},"citing_paper":{"arxiv_id":"2508.02362","last_updated":"2025-08-04T12:50:22Z","snapshot_observed_at":"2026-08-17T09:18:20.700203Z","submitted_at":"2025-08-04T12:50:22Z","title":"Text2Lip: Progressive Lip-Synced Talking Face Generation from Text via Viseme-Guided Rendering","version":1},"reference_index":21,"source":"arxiv_source","source_observed_at":"2026-08-06T05:05:47.481043Z"},"links":{"citing_paper":"/paper/2508.02362"},"observation_digest":"sha256:d09113a28598f84eac458782872236dfd4e81461c28fabce3be2f61b53108947","observation_id":"c36a0f76-6530-4354-a0cb-25f281b83ec8","resolution":{"observed_at":"2026-08-06T05:05:51.306530Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T05:05:51.097615Z","title":null,"venue":null,"work_id":"dc89c57d-8dd1-43d1-a008-051e7fbc4969","year":1997},"citing_paper":{"arxiv_id":"2508.02362","last_updated":"2025-08-04T12:50:22Z","snapshot_observed_at":"2026-08-17T09:18:20.700203Z","submitted_at":"2025-08-04T12:50:22Z","title":"Text2Lip: Progressive Lip-Synced Talking Face Generation from Text via Viseme-Guided Rendering","version":1},"reference_index":22,"source":"arxiv_source","source_observed_at":"2026-08-06T05:05:47.625766Z"},"links":{"citing_paper":"/paper/2508.02362"},"observation_digest":"sha256:e39345fc00ebb24b6fc5282e9cd62b0dd70e91200289056aac8f66405de685f5","observation_id":"9fd5b4a5-707b-49fa-b6d9-805a38591f09","resolution":{"observed_at":"2026-08-06T05:05:51.166371Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T05:05:47.708276Z","title":null,"venue":null,"work_id":null,"year":2002},"citing_paper":{"arxiv_id":"2508.02362","last_updated":"2025-08-04T12:50:22Z","snapshot_observed_at":"2026-08-17T09:18:20.700203Z","submitted_at":"2025-08-04T12:50:22Z","title":"Text2Lip: Progressive Lip-Synced Talking Face Generation from Text via Viseme-Guided Rendering","version":1},"reference_index":23,"source":"arxiv_source","source_observed_at":"2026-08-06T05:05:47.708276Z"},"links":{"citing_paper":"/paper/2508.02362"},"observation_digest":"sha256:8317f43680ea1a94c4321f129d80e2edee0d01204f7c4d3560a6ca6b8b1632bc","observation_id":"bd0f4409-87f9-4e94-9a07-450cf38a51dc","resolution":{"observed_at":"2026-08-06T05:05:47.708276Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T05:05:50.976935Z","title":"J.; Kim, M.; Hong, J.; Choi, J.; and Ro, Y","venue":null,"work_id":"28a6510d-e73a-4563-a4b9-d974b18c8fe1","year":2022},"citing_paper":{"arxiv_id":"2508.02362","last_updated":"2025-08-04T12:50:22Z","snapshot_observed_at":"2026-08-17T09:18:20.700203Z","submitted_at":"2025-08-04T12:50:22Z","title":"Text2Lip: Progressive Lip-Synced Talking Face Generation from Text via Viseme-Guided Rendering","version":1},"reference_index":24,"source":"arxiv_source","source_observed_at":"2026-08-06T05:05:47.808845Z"},"links":{"citing_paper":"/paper/2508.02362"},"observation_digest":"sha256:7de7a6c529b2df1dcddf3577325ff63389e35a5e8a05b1115443b639c3eac20b","observation_id":"809b355e-2721-446c-8198-1ee983b73a8c","resolution":{"observed_at":"2026-08-06T05:05:51.024838Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T05:05:50.828335Z","title":"P.; and Jawahar, C","venue":null,"work_id":"02d169d5-b882-4296-9e4d-2c34b7a7ecaf","year":2020},"citing_paper":{"arxiv_id":"2508.02362","last_updated":"2025-08-04T12:50:22Z","snapshot_observed_at":"2026-08-17T09:18:20.700203Z","submitted_at":"2025-08-04T12:50:22Z","title":"Text2Lip: Progressive Lip-Synced Talking Face Generation from Text via Viseme-Guided Rendering","version":1},"reference_index":25,"source":"arxiv_source","source_observed_at":"2026-08-06T05:05:47.868222Z"},"links":{"citing_paper":"/paper/2508.02362"},"observation_digest":"sha256:b51bf2debf915b776b44a6b917f5ccd36bd28cfb724bbd054693e6ed560b33ed","observation_id":"4bc80309-79eb-414d-9ee7-ef97a7877356","resolution":{"observed_at":"2026-08-06T05:05:50.902746Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T05:05:50.702964Z","title":null,"venue":null,"work_id":"9ac2f7fc-0bde-4410-9584-f929f86b589d","year":2003},"citing_paper":{"arxiv_id":"2508.02362","last_updated":"2025-08-04T12:50:22Z","snapshot_observed_at":"2026-08-17T09:18:20.700203Z","submitted_at":"2025-08-04T12:50:22Z","title":"Text2Lip: Progressive Lip-Synced Talking Face Generation from Text via Viseme-Guided Rendering","version":1},"reference_index":26,"source":"arxiv_source","source_observed_at":"2026-08-06T05:05:47.928685Z"},"links":{"citing_paper":"/paper/2508.02362"},"observation_digest":"sha256:027386a763ecf463ece177c90d02018e26d0dc284de08631773ba3f8703a7098","observation_id":"fbba3307-b865-4f8c-865f-67e96896f54e","resolution":{"observed_at":"2026-08-06T05:05:50.749797Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T05:05:50.567742Z","title":"C.; and Bowden, R","venue":null,"work_id":"6f577430-7c36-4ede-9536-c4625f3051c7","year":2020},"citing_paper":{"arxiv_id":"2508.02362","last_updated":"2025-08-04T12:50:22Z","snapshot_observed_at":"2026-08-17T09:18:20.700203Z","submitted_at":"2025-08-04T12:50:22Z","title":"Text2Lip: Progressive Lip-Synced Talking Face Generation from Text via Viseme-Guided Rendering","version":1},"reference_index":27,"source":"arxiv_source","source_observed_at":"2026-08-06T05:05:48.012934Z"},"links":{"citing_paper":"/paper/2508.02362"},"observation_digest":"sha256:bf18a7ee1ac330b8b0f3c15da2e5322771988da712dd13f4432a9f34ba40fa20","observation_id":"86913b37-774f-4a56-81ba-ebcc9d970208","resolution":{"observed_at":"2026-08-06T05:05:50.626784Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1703.04105","last_updated":"2017-09-08T10:08:34Z","snapshot_observed_at":"2026-08-18T10:22:24.078790Z","submitted_at":"2017-03-12T12:06:04Z","title":"Combining Residual Networks with LSTMs for Lipreading","version":4},"cited_work":{"arxiv_id":"1703.04105","doi":null,"metadata_source":"pith","pith_arxiv_id":"1703.04105","snapshot_observed_at":"2026-08-06T05:05:49.707615Z","title":"Combining Residual Networks with LSTMs for Lipreading","venue":"cs.CV","work_id":"ac3f9b64-2041-4b6e-9205-80bdcc0881a5","year":2017},"citing_paper":{"arxiv_id":"2508.02362","last_updated":"2025-08-04T12:50:22Z","snapshot_observed_at":"2026-08-17T09:18:20.700203Z","submitted_at":"2025-08-04T12:50:22Z","title":"Text2Lip: Progressive Lip-Synced Talking Face Generation from Text via Viseme-Guided Rendering","version":1},"reference_index":28,"source":"arxiv_source","source_observed_at":"2026-08-06T05:05:48.097764Z"},"links":{"cited_paper":"/paper/1703.04105","citing_paper":"/paper/2508.02362"},"observation_digest":"sha256:e049de2ae92e282c9e7c1534f95d8906128cde71b9d8466be86926296ffefb7b","observation_id":"fc19420b-9f8c-4d15-9130-4a9b5bbc8e01","resolution":{"observed_at":"2026-08-06T05:05:49.794001Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T05:05:48.173586Z","title":null,"venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2508.02362","last_updated":"2025-08-04T12:50:22Z","snapshot_observed_at":"2026-08-17T09:18:20.700203Z","submitted_at":"2025-08-04T12:50:22Z","title":"Text2Lip: Progressive Lip-Synced Talking Face Generation from Text via Viseme-Guided Rendering","version":1},"reference_index":29,"source":"arxiv_source","source_observed_at":"2026-08-06T05:05:48.173586Z"},"links":{"citing_paper":"/paper/2508.02362"},"observation_digest":"sha256:ef8a3428714b3e0278c703107d207b572633144b02e87a4d340bc386afe91445","observation_id":"8775f144-b22a-416f-b1c4-cf03a27c6ba9","resolution":{"observed_at":"2026-08-06T05:05:48.173586Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T05:05:48.243031Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2508.02362","last_updated":"2025-08-04T12:50:22Z","snapshot_observed_at":"2026-08-17T09:18:20.700203Z","submitted_at":"2025-08-04T12:50:22Z","title":"Text2Lip: Progressive Lip-Synced Talking Face Generation from Text via Viseme-Guided Rendering","version":1},"reference_index":30,"source":"arxiv_source","source_observed_at":"2026-08-06T05:05:48.243031Z"},"links":{"citing_paper":"/paper/2508.02362"},"observation_digest":"sha256:ceef434c0d6d4b733f24038d78d82adcc9efa5d5fdc209c73d93302c600f023e","observation_id":"9b4966f3-f6d6-4610-bd7f-dc00ba890577","resolution":{"observed_at":"2026-08-06T05:05:48.243031Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T05:05:48.322340Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2508.02362","last_updated":"2025-08-04T12:50:22Z","snapshot_observed_at":"2026-08-17T09:18:20.700203Z","submitted_at":"2025-08-04T12:50:22Z","title":"Text2Lip: Progressive Lip-Synced Talking Face Generation from Text via Viseme-Guided Rendering","version":1},"reference_index":31,"source":"arxiv_source","source_observed_at":"2026-08-06T05:05:48.322340Z"},"links":{"citing_paper":"/paper/2508.02362"},"observation_digest":"sha256:ca8709a298cede41692698f81386ce5479d1c165aec36e6ee45e56026737cc11","observation_id":"020de91c-5420-40b3-bd67-b170ab3584f3","resolution":{"observed_at":"2026-08-06T05:05:48.322340Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T05:05:48.400150Z","title":null,"venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2508.02362","last_updated":"2025-08-04T12:50:22Z","snapshot_observed_at":"2026-08-17T09:18:20.700203Z","submitted_at":"2025-08-04T12:50:22Z","title":"Text2Lip: Progressive Lip-Synced Talking Face Generation from Text via Viseme-Guided Rendering","version":1},"reference_index":32,"source":"arxiv_source","source_observed_at":"2026-08-06T05:05:48.400150Z"},"links":{"citing_paper":"/paper/2508.02362"},"observation_digest":"sha256:f96e3cde563342e86da6246d2d3bd81e6b65e55aab5ce8ee37bd2e712bafaa33","observation_id":"57ca52fe-c94e-4739-90b3-01ea8046d41b","resolution":{"observed_at":"2026-08-06T05:05:48.400150Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T05:05:48.491050Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2508.02362","last_updated":"2025-08-04T12:50:22Z","snapshot_observed_at":"2026-08-17T09:18:20.700203Z","submitted_at":"2025-08-04T12:50:22Z","title":"Text2Lip: Progressive Lip-Synced Talking Face Generation from Text via Viseme-Guided Rendering","version":1},"reference_index":33,"source":"arxiv_source","source_observed_at":"2026-08-06T05:05:48.491050Z"},"links":{"citing_paper":"/paper/2508.02362"},"observation_digest":"sha256:bbbfaaca9da3e41b2cbf34f74aa96164cda84a75466aba3e3933d75bb9b912e8","observation_id":"5cd6008b-9c64-48ca-bc26-54772aebed49","resolution":{"observed_at":"2026-08-06T05:05:48.491050Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1812.01717","last_updated":"2019-03-27T16:43:17Z","snapshot_observed_at":"2026-08-18T04:00:09.136122Z","submitted_at":"2018-12-03T03:57:42Z","title":"Towards Accurate Generative Models of Video: A New Metric & Challenges","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1812.01717","snapshot_observed_at":"2026-08-06T05:05:48.595002Z","title":null,"venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2508.02362","last_updated":"2025-08-04T12:50:22Z","snapshot_observed_at":"2026-08-17T09:18:20.700203Z","submitted_at":"2025-08-04T12:50:22Z","title":"Text2Lip: Progressive Lip-Synced Talking Face Generation from Text via Viseme-Guided Rendering","version":1},"reference_index":34,"source":"arxiv_source","source_observed_at":"2026-08-06T05:05:48.595002Z"},"links":{"cited_paper":"/paper/1812.01717","citing_paper":"/paper/2508.02362"},"observation_digest":"sha256:f632d7ee53bfbfdfa08a83e689ef290d88dea601c7fd4acc2a2cd87cb0c339e1","observation_id":"34b8ba25-3eb0-44c6-a95c-b3a39014058e","resolution":{"observed_at":"2026-08-06T05:05:48.595002Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T05:05:50.455992Z","title":"N.; Kaiser, .; and Polosukhin, I","venue":null,"work_id":"65ed8905-fd43-445f-8a4a-74451bec62fa","year":2017},"citing_paper":{"arxiv_id":"2508.02362","last_updated":"2025-08-04T12:50:22Z","snapshot_observed_at":"2026-08-17T09:18:20.700203Z","submitted_at":"2025-08-04T12:50:22Z","title":"Text2Lip: Progressive Lip-Synced Talking Face Generation from Text via Viseme-Guided Rendering","version":1},"reference_index":35,"source":"arxiv_source","source_observed_at":"2026-08-06T05:05:48.693825Z"},"links":{"citing_paper":"/paper/2508.02362"},"observation_digest":"sha256:6733d72a31b78efec00e8b7958847ae09ce14eb514eca14db25139c89e396c69","observation_id":"42279d98-343a-4a49-9169-e23a142c0737","resolution":{"observed_at":"2026-08-06T05:05:50.494681Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2406.02511","last_updated":"2024-06-04T17:32:52Z","snapshot_observed_at":"2026-08-19T07:28:01.288662Z","submitted_at":"2024-06-04T17:32:52Z","title":"V-Express: Conditional Dropout for Progressive Training of Portrait Video Generation","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2406.02511","snapshot_observed_at":"2026-08-06T05:05:48.759306Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2508.02362","last_updated":"2025-08-04T12:50:22Z","snapshot_observed_at":"2026-08-17T09:18:20.700203Z","submitted_at":"2025-08-04T12:50:22Z","title":"Text2Lip: Progressive Lip-Synced Talking Face Generation from Text via Viseme-Guided Rendering","version":1},"reference_index":36,"source":"arxiv_source","source_observed_at":"2026-08-06T05:05:48.759306Z"},"links":{"cited_paper":"/paper/2406.02511","citing_paper":"/paper/2508.02362"},"observation_digest":"sha256:e12afdb829ebc55b7eb6e0e2ee8af37f373a6b082d3d0b40b3298c82a88f25ed","observation_id":"7ce530bd-40aa-469e-adc9-d68d084b7a8a","resolution":{"observed_at":"2026-08-06T05:05:48.759306Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T05:05:50.323034Z","title":null,"venue":null,"work_id":"c881ccf5-1d97-4b07-a224-f9327d4465b7","year":2021},"citing_paper":{"arxiv_id":"2508.02362","last_updated":"2025-08-04T12:50:22Z","snapshot_observed_at":"2026-08-17T09:18:20.700203Z","submitted_at":"2025-08-04T12:50:22Z","title":"Text2Lip: Progressive Lip-Synced Talking Face Generation from Text via Viseme-Guided Rendering","version":1},"reference_index":37,"source":"arxiv_source","source_observed_at":"2026-08-06T05:05:48.797697Z"},"links":{"citing_paper":"/paper/2508.02362"},"observation_digest":"sha256:935ec9c39bdd3eeb83b85e28cc75ef2ef850ec1278181a83baaa33a46e143855","observation_id":"6ab6fe53-28d3-4bd6-aef0-4d2c7d52d9f0","resolution":{"observed_at":"2026-08-06T05:05:50.387518Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2506.11621","last_updated":"2025-06-13T09:44:42Z","snapshot_observed_at":"2026-08-18T10:26:41.888804Z","submitted_at":"2025-06-13T09:44:42Z","title":"SignAligner: Harmonizing Complementary Pose Modalities for Coherent Sign Language Generation","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2506.11621","snapshot_observed_at":"2026-08-06T05:05:48.835942Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2508.02362","last_updated":"2025-08-04T12:50:22Z","snapshot_observed_at":"2026-08-17T09:18:20.700203Z","submitted_at":"2025-08-04T12:50:22Z","title":"Text2Lip: Progressive Lip-Synced Talking Face Generation from Text via Viseme-Guided Rendering","version":1},"reference_index":38,"source":"arxiv_source","source_observed_at":"2026-08-06T05:05:48.835942Z"},"links":{"cited_paper":"/paper/2506.11621","citing_paper":"/paper/2508.02362"},"observation_digest":"sha256:b9525367a4bd5a4d1ac1b1b4e8c46244a7c2a2af132d867979145653fda5c624","observation_id":"90ee3e0c-22fa-40dc-b0aa-011d65ad5fc9","resolution":{"observed_at":"2026-08-06T05:05:48.835942Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T05:05:50.225939Z","title":null,"venue":null,"work_id":"ffce733f-d318-41ee-9b23-a98907fb37b0","year":2025},"citing_paper":{"arxiv_id":"2508.02362","last_updated":"2025-08-04T12:50:22Z","snapshot_observed_at":"2026-08-17T09:18:20.700203Z","submitted_at":"2025-08-04T12:50:22Z","title":"Text2Lip: Progressive Lip-Synced Talking Face Generation from Text via Viseme-Guided Rendering","version":1},"reference_index":39,"source":"arxiv_source","source_observed_at":"2026-08-06T05:05:48.885323Z"},"links":{"citing_paper":"/paper/2508.02362"},"observation_digest":"sha256:2a5dd1bcff3a5fb18e44371fc78d66314626861f7b170f386080995d7cd04af3","observation_id":"af8d4925-d892-4d4c-b023-ea8c3c0dab8b","resolution":{"observed_at":"2026-08-06T05:05:50.280744Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T05:05:48.939674Z","title":"C.; Sheikh, H","venue":null,"work_id":null,"year":2004},"citing_paper":{"arxiv_id":"2508.02362","last_updated":"2025-08-04T12:50:22Z","snapshot_observed_at":"2026-08-17T09:18:20.700203Z","submitted_at":"2025-08-04T12:50:22Z","title":"Text2Lip: Progressive Lip-Synced Talking Face Generation from Text via Viseme-Guided Rendering","version":1},"reference_index":40,"source":"arxiv_source","source_observed_at":"2026-08-06T05:05:48.939674Z"},"links":{"citing_paper":"/paper/2508.02362"},"observation_digest":"sha256:e1f28505eb559dca388deef117aac5ed62a8e12096b716eeb4690e9513b0b96d","observation_id":"b867d1ff-d4d2-4981-8854-e758efd37b6a","resolution":{"observed_at":"2026-08-06T05:05:48.939674Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2503.23307","last_updated":"2025-03-30T04:22:09Z","snapshot_observed_at":"2026-08-17T18:53:50.853973Z","submitted_at":"2025-03-30T04:22:09Z","title":"MoCha: Towards Movie-Grade Talking Character Synthesis","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2503.23307","snapshot_observed_at":"2026-08-06T05:05:49.072437Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2508.02362","last_updated":"2025-08-04T12:50:22Z","snapshot_observed_at":"2026-08-17T09:18:20.700203Z","submitted_at":"2025-08-04T12:50:22Z","title":"Text2Lip: Progressive Lip-Synced Talking Face Generation from Text via Viseme-Guided Rendering","version":1},"reference_index":41,"source":"arxiv_source","source_observed_at":"2026-08-06T05:05:49.072437Z"},"links":{"cited_paper":"/paper/2503.23307","citing_paper":"/paper/2508.02362"},"observation_digest":"sha256:5c7a57fc9b8d627de19f425df2ff61e193346b018e60c2028e9b9b40f658726b","observation_id":"9416b590-3d2b-47f4-9035-2dc81d9e28f6","resolution":{"observed_at":"2026-08-06T05:05:49.072437Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2403.17694","last_updated":"2024-03-26T13:35:02Z","snapshot_observed_at":"2026-08-18T10:29:36.587877Z","submitted_at":"2024-03-26T13:35:02Z","title":"AniPortrait: Audio-Driven Synthesis of Photorealistic Portrait Animation","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2403.17694","snapshot_observed_at":"2026-08-06T05:05:49.133791Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2508.02362","last_updated":"2025-08-04T12:50:22Z","snapshot_observed_at":"2026-08-17T09:18:20.700203Z","submitted_at":"2025-08-04T12:50:22Z","title":"Text2Lip: Progressive Lip-Synced Talking Face Generation from Text via Viseme-Guided Rendering","version":1},"reference_index":42,"source":"arxiv_source","source_observed_at":"2026-08-06T05:05:49.133791Z"},"links":{"cited_paper":"/paper/2403.17694","citing_paper":"/paper/2508.02362"},"observation_digest":"sha256:61003f3a39f6498319c1fbf97158e653ed91e14ea70af01e7e9d78a59792f4a0","observation_id":"247b5a6b-0495-44f0-bebb-21bf2c18ce6e","resolution":{"observed_at":"2026-08-06T05:05:49.133791Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2406.08801","last_updated":"2024-06-16T07:10:41Z","snapshot_observed_at":"2026-08-18T10:23:27.377504Z","submitted_at":"2024-06-13T04:33:20Z","title":"Hallo: Hierarchical Audio-Driven Visual Synthesis for Portrait Image Animation","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2406.08801","snapshot_observed_at":"2026-08-06T05:05:49.218801Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2508.02362","last_updated":"2025-08-04T12:50:22Z","snapshot_observed_at":"2026-08-17T09:18:20.700203Z","submitted_at":"2025-08-04T12:50:22Z","title":"Text2Lip: Progressive Lip-Synced Talking Face Generation from Text via Viseme-Guided Rendering","version":1},"reference_index":43,"source":"arxiv_source","source_observed_at":"2026-08-06T05:05:49.218801Z"},"links":{"cited_paper":"/paper/2406.08801","citing_paper":"/paper/2508.02362"},"observation_digest":"sha256:1f3a282416eac96875d8f9b6311f0070521b917026c1876b0be59635eb9a054f","observation_id":"0c392671-72de-46ef-b7e9-d6338604c9e0","resolution":{"observed_at":"2026-08-06T05:05:49.218801Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T05:05:50.115286Z","title":null,"venue":null,"work_id":"912badf4-96d1-4745-91f7-0a4c1e1ffc5a","year":2024},"citing_paper":{"arxiv_id":"2508.02362","last_updated":"2025-08-04T12:50:22Z","snapshot_observed_at":"2026-08-17T09:18:20.700203Z","submitted_at":"2025-08-04T12:50:22Z","title":"Text2Lip: Progressive Lip-Synced Talking Face Generation from Text via Viseme-Guided Rendering","version":1},"reference_index":44,"source":"arxiv_source","source_observed_at":"2026-08-06T05:05:49.285013Z"},"links":{"citing_paper":"/paper/2508.02362"},"observation_digest":"sha256:1f68a25de96aa080d52d165b79c59a01d904b7f3dcf17de15f53be89d3e40072","observation_id":"6a10265b-b20b-478c-a3be-9d7cccadac2a","resolution":{"observed_at":"2026-08-06T05:05:50.171626Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2312.13578","last_updated":"2023-12-21T05:03:18Z","snapshot_observed_at":"2026-08-18T10:22:53.196015Z","submitted_at":"2023-12-21T05:03:18Z","title":"DREAM-Talk: Diffusion-based Realistic Emotional Audio-driven Method for Single Image Talking Face Generation","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2312.13578","snapshot_observed_at":"2026-08-06T05:05:49.343432Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2508.02362","last_updated":"2025-08-04T12:50:22Z","snapshot_observed_at":"2026-08-17T09:18:20.700203Z","submitted_at":"2025-08-04T12:50:22Z","title":"Text2Lip: Progressive Lip-Synced Talking Face Generation from Text via Viseme-Guided Rendering","version":1},"reference_index":45,"source":"arxiv_source","source_observed_at":"2026-08-06T05:05:49.343432Z"},"links":{"cited_paper":"/paper/2312.13578","citing_paper":"/paper/2508.02362"},"observation_digest":"sha256:65aebaa79e7071cf6eec52051df8fc792bccaf49df3de4eb26657199242613aa","observation_id":"ad1a78ca-7191-4de8-9773-850d026b6216","resolution":{"observed_at":"2026-08-06T05:05:49.343432Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T05:05:49.453980Z","title":"A.; Shechtman, E.; and Wang, O","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2508.02362","last_updated":"2025-08-04T12:50:22Z","snapshot_observed_at":"2026-08-17T09:18:20.700203Z","submitted_at":"2025-08-04T12:50:22Z","title":"Text2Lip: Progressive Lip-Synced Talking Face Generation from Text via Viseme-Guided Rendering","version":1},"reference_index":46,"source":"arxiv_source","source_observed_at":"2026-08-06T05:05:49.453980Z"},"links":{"citing_paper":"/paper/2508.02362"},"observation_digest":"sha256:f0a47ca2e7ed33ff99208ef6af517ec1e8d0d4ff8263dcb02daf7ed56398f461","observation_id":"0201e5ea-40e8-484e-a0c0-778be2b0d985","resolution":{"observed_at":"2026-08-06T05:05:49.453980Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T05:05:49.967307Z","title":null,"venue":null,"work_id":"fa69483f-b3cc-4f41-8521-79a90d57d895","year":2023},"citing_paper":{"arxiv_id":"2508.02362","last_updated":"2025-08-04T12:50:22Z","snapshot_observed_at":"2026-08-17T09:18:20.700203Z","submitted_at":"2025-08-04T12:50:22Z","title":"Text2Lip: Progressive Lip-Synced Talking Face Generation from Text via Viseme-Guided Rendering","version":1},"reference_index":47,"source":"arxiv_source","source_observed_at":"2026-08-06T05:05:49.510269Z"},"links":{"citing_paper":"/paper/2508.02362"},"observation_digest":"sha256:6c939e73c39133a8db79f2f0df5854e7058614b2275427abaaa9b36f7f61e74c","observation_id":"a43a4332-659a-408d-8547-5ced62b17324","resolution":{"observed_at":"2026-08-06T05:05:50.057818Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T05:05:49.862897Z","title":null,"venue":null,"work_id":"1b5221c0-a7a9-47b9-b15a-77fef6291291","year":2020},"citing_paper":{"arxiv_id":"2508.02362","last_updated":"2025-08-04T12:50:22Z","snapshot_observed_at":"2026-08-17T09:18:20.700203Z","submitted_at":"2025-08-04T12:50:22Z","title":"Text2Lip: Progressive Lip-Synced Talking Face Generation from Text via Viseme-Guided Rendering","version":1},"reference_index":48,"source":"arxiv_source","source_observed_at":"2026-08-06T05:05:49.574658Z"},"links":{"citing_paper":"/paper/2508.02362"},"observation_digest":"sha256:cee23e6c4f236142dedbf4b21e5973fc21f4c19127023a4044dc0d79aa71e5e1","observation_id":"291abcda-bf3e-48a7-b663-adc9e8c09fb0","resolution":{"observed_at":"2026-08-06T05:05:49.926096Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}}],"paper":{"arxiv_id":"2508.02362","last_updated":"2025-08-04T12:50:22Z","latest_version":1,"primary_category":"cs.CV","snapshot_observed_at":"2026-08-17T09:18:20.700203Z","submitted_at":"2025-08-04T12:50:22Z","title":"Text2Lip: Progressive Lip-Synced Talking Face Generation from Text via Viseme-Guided Rendering"},"reference_resolution":{"displayed":48,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":41,"verified_exact":1,"verified_fuzzy":6},"total_outbound_references":48},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"thesis":"As of 20 August 2026, this Paper Citation Record lists 48 of 48 outbound references and 1 inbound Pith citation observation for arXiv:2508.02362."}