{"as_of":"2026-08-09T17:29:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:b6e914abba9613831e0c2e5a75e8bd3989b339141ec18f218ae005551f0b86bb","coverage":[{"denominator":0,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":17,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":17,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-09T06:31:02.800959+00:00","state":"measured"},{"denominator":17,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":17,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-07T14:02:29.621663Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"arxiv_reference","source_observed_at":"2026-07-03T04:47:38.002589Z","state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2504.04842","last_updated":"2025-04-07T08:56:01Z","snapshot_observed_at":"2026-08-09T02:00:54.345290Z","submitted_at":"2025-04-07T08:56:01Z","title":"FantasyTalking: Realistic Talking Portrait Generation via Coherent Motion Synthesis","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2504.04842","snapshot_observed_at":"2026-08-07T14:02:29.621663Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2505.20156","last_updated":"2025-06-03T15:15:31Z","snapshot_observed_at":"2026-08-07T13:55:40.621856Z","submitted_at":"2025-05-26T15:57:27Z","title":"HunyuanVideo-Avatar: High-Fidelity Audio-Driven Human Animation for Multiple Characters","version":2},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-08-07T14:02:29.621663Z"},"links":{"cited_paper":"/paper/2504.04842","citing_paper":"/paper/2505.20156"},"observation_digest":"sha256:167049a1d959a959d078a2cbfe37fa5f579fdd5dcaeb7c616fa50738c49c276d","observation_id":"23562447-b0cf-4b97-8e8b-76addc290927","resolution":{"observed_at":"2026-08-07T14:02:29.621663Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2504.04842","last_updated":"2025-04-07T08:56:01Z","snapshot_observed_at":"2026-08-09T02:00:54.345290Z","submitted_at":"2025-04-07T08:56:01Z","title":"FantasyTalking: Realistic Talking Portrait Generation via Coherent Motion Synthesis","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2504.04842","snapshot_observed_at":"2026-08-07T13:07:32.607328Z","title":"Fantasytalking: Realistic talking portrait generation via coherent motion synthesis","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2505.22647","last_updated":"2025-05-28T17:57:06Z","snapshot_observed_at":"2026-08-07T20:49:17.257002Z","submitted_at":"2025-05-28T17:57:06Z","title":"Let Them Talk: Audio-Driven Multi-Person Conversational Video Generation","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-07T13:07:32.607328Z"},"links":{"cited_paper":"/paper/2504.04842","citing_paper":"/paper/2505.22647"},"observation_digest":"sha256:9e1fe5965cfb7c5d605235e85966ac1ca38852b49f0a30d70b302ebf1cffa46f","observation_id":"259b03b1-ff70-43b9-b91d-4b75e3601cab","resolution":{"observed_at":"2026-08-07T13:07:32.607328Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2504.04842","last_updated":"2025-04-07T08:56:01Z","snapshot_observed_at":"2026-08-09T02:00:54.345290Z","submitted_at":"2025-04-07T08:56:01Z","title":"FantasyTalking: Realistic Talking Portrait Generation via Coherent Motion Synthesis","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2504.04842","snapshot_observed_at":"2026-08-07T12:01:08.579080Z","title":"Fantasytalking: Realistic talking portrait generation via coherent motion synthesis","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2506.00830","last_updated":"2025-06-01T04:27:13Z","snapshot_observed_at":"2026-08-07T20:51:49.766697Z","submitted_at":"2025-06-01T04:27:13Z","title":"SkyReels-Audio: Omni Audio-Conditioned Talking Portraits in Video Diffusion Transformers","version":1},"reference_index":65,"source":"pdf_text","source_observed_at":"2026-08-07T12:01:08.579080Z"},"links":{"cited_paper":"/paper/2504.04842","citing_paper":"/paper/2506.00830"},"observation_digest":"sha256:cd30b7c1fe2159c5d41b22a684bb0ca8c0dc7719072890b81ed18ae5c538d319","observation_id":"005dad01-d72c-4c8f-a3ec-0c0f2d47335a","resolution":{"observed_at":"2026-08-07T12:01:08.579080Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2504.04842","last_updated":"2025-04-07T08:56:01Z","snapshot_observed_at":"2026-08-09T02:00:54.345290Z","submitted_at":"2025-04-07T08:56:01Z","title":"FantasyTalking: Realistic Talking Portrait Generation via Coherent Motion Synthesis","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2504.04842","snapshot_observed_at":"2026-08-07T04:55:28.875127Z","title":"Fantasytalking: Realistic talking portrait generation via coherent motion synthesis","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2506.11144","last_updated":"2025-06-11T05:33:03Z","snapshot_observed_at":"2026-08-07T04:46:32.123425Z","submitted_at":"2025-06-11T05:33:03Z","title":"AlignHuman: Improving Motion and Fidelity via Timestep-Segment Preference Optimization for Audio-Driven Human Animation","version":1},"reference_index":37,"source":"pdf_text","source_observed_at":"2026-08-07T04:55:28.875127Z"},"links":{"cited_paper":"/paper/2504.04842","citing_paper":"/paper/2506.11144"},"observation_digest":"sha256:ba8496855bc764e054ddc8a0b851b106467300e70df11b89a32d385132483eb8","observation_id":"ab4b4deb-7c2c-47d2-8177-452149814295","resolution":{"observed_at":"2026-08-07T04:55:28.875127Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2504.04842","last_updated":"2025-04-07T08:56:01Z","snapshot_observed_at":"2026-08-09T02:00:54.345290Z","submitted_at":"2025-04-07T08:56:01Z","title":"FantasyTalking: Realistic Talking Portrait Generation via Coherent Motion Synthesis","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2504.04842","snapshot_observed_at":"2026-08-06T17:49:46.738652Z","title":"Fanta- sytalking: Realistic talking portrait generation via coherent motion synthesis","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2507.09862","last_updated":"2025-07-14T02:22:47Z","snapshot_observed_at":"2026-08-06T17:43:06.615236Z","submitted_at":"2025-07-14T02:22:47Z","title":"SpeakerVid-5M: A Large-Scale High-Quality Dataset for Audio-Visual Dyadic Interactive Human Generation","version":1},"reference_index":58,"source":"pdf_text","source_observed_at":"2026-08-06T17:49:46.738652Z"},"links":{"cited_paper":"/paper/2504.04842","citing_paper":"/paper/2507.09862"},"observation_digest":"sha256:02841e405a71c932c6246c56cb9f75f6d81dec92849e7f71b9948fc9cd7f0c7c","observation_id":"736c1bca-251c-4914-b188-6a0b6334b529","resolution":{"observed_at":"2026-08-06T17:49:46.738652Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2504.04842","last_updated":"2025-04-07T08:56:01Z","snapshot_observed_at":"2026-08-09T02:00:54.345290Z","submitted_at":"2025-04-07T08:56:01Z","title":"FantasyTalking: Realistic Talking Portrait Generation via Coherent Motion Synthesis","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2504.04842","snapshot_observed_at":"2026-08-06T16:39:38.613422Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2507.12956","last_updated":"2025-07-17T09:50:43Z","snapshot_observed_at":"2026-08-07T23:26:25.424237Z","submitted_at":"2025-07-17T09:50:43Z","title":"FantasyPortrait: Enhancing Multi-Character Portrait Animation with Expression-Augmented Diffusion Transformers","version":1},"reference_index":49,"source":"arxiv_source","source_observed_at":"2026-08-06T16:39:38.613422Z"},"links":{"cited_paper":"/paper/2504.04842","citing_paper":"/paper/2507.12956"},"observation_digest":"sha256:ab9b17a04047ba0a607cc4101dc4264291dc9d67164c786ed2d1818dbf37596e","observation_id":"114aa39a-d545-40bd-b713-bfd6ca3b771f","resolution":{"observed_at":"2026-08-06T16:39:38.613422Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2504.04842","last_updated":"2025-04-07T08:56:01Z","snapshot_observed_at":"2026-08-09T02:00:54.345290Z","submitted_at":"2025-04-07T08:56:01Z","title":"FantasyTalking: Realistic Talking Portrait Generation via Coherent Motion Synthesis","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2504.04842","snapshot_observed_at":"2026-08-05T20:06:49.148058Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2508.11255","last_updated":"2025-08-15T06:43:46Z","snapshot_observed_at":"2026-08-08T07:02:19.422958Z","submitted_at":"2025-08-15T06:43:46Z","title":"FantasyTalking2: Timestep-Layer Adaptive Preference Optimization for Audio-Driven Portrait Animation","version":1},"reference_index":52,"source":"arxiv_source","source_observed_at":"2026-08-05T20:06:49.148058Z"},"links":{"cited_paper":"/paper/2504.04842","citing_paper":"/paper/2508.11255"},"observation_digest":"sha256:00e6466ffa717af164664069544b285ebd5d7a74fba9b223999c8902f1b49618","observation_id":"bcaefb3f-3e96-453b-9af3-2d8aeef63864","resolution":{"observed_at":"2026-08-05T20:06:49.148058Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2504.04842","last_updated":"2025-04-07T08:56:01Z","snapshot_observed_at":"2026-08-09T02:00:54.345290Z","submitted_at":"2025-04-07T08:56:01Z","title":"FantasyTalking: Realistic Talking Portrait Generation via Coherent Motion Synthesis","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2504.04842","snapshot_observed_at":"2026-08-05T18:50:16.285909Z","title":"Fantasytalking: Realistic talking portrait generation via coherent motion synthesis.arXiv preprint arXiv:2504.04842,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2508.14033","last_updated":"2025-08-19T17:55:23Z","snapshot_observed_at":"2026-08-05T18:50:15.388089Z","submitted_at":"2025-08-19T17:55:23Z","title":"InfiniteTalk: Audio-driven Video Generation for Sparse-Frame Video Dubbing","version":1},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-05T18:50:16.285909Z"},"links":{"cited_paper":"/paper/2504.04842","citing_paper":"/paper/2508.14033"},"observation_digest":"sha256:77d410a4d39c914c8854e46d5e73b490fb6e566ec2c4c0f276eebf85172b7508","observation_id":"ce572680-1171-40d8-af1b-acf777ebf76e","resolution":{"observed_at":"2026-08-05T18:50:16.285909Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2504.04842","last_updated":"2025-04-07T08:56:01Z","snapshot_observed_at":"2026-08-09T02:00:54.345290Z","submitted_at":"2025-04-07T08:56:01Z","title":"FantasyTalking: Realistic Talking Portrait Generation via Coherent Motion Synthesis","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2504.04842","snapshot_observed_at":"2026-08-05T16:24:59.254749Z","title":"Fantasytalking: Realistic talking portrait generation via coherent motion syn- thesis","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2508.18621","last_updated":"2025-08-26T02:51:31Z","snapshot_observed_at":"2026-08-07T12:23:53.377738Z","submitted_at":"2025-08-26T02:51:31Z","title":"Wan-S2V: Audio-Driven Cinematic Video Generation","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-05T16:24:59.254749Z"},"links":{"cited_paper":"/paper/2504.04842","citing_paper":"/paper/2508.18621"},"observation_digest":"sha256:cb52914a8996841fb456dc9c1b50d58d1d7b032630663ca3c331742ef3ddde04","observation_id":"54d8d8a5-a960-4da1-b302-d210086694cd","resolution":{"observed_at":"2026-08-05T16:24:59.254749Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2504.04842","last_updated":"2025-04-07T08:56:01Z","snapshot_observed_at":"2026-08-09T02:00:54.345290Z","submitted_at":"2025-04-07T08:56:01Z","title":"FantasyTalking: Realistic Talking Portrait Generation via Coherent Motion Synthesis","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2504.04842","snapshot_observed_at":"2026-08-05T15:19:37.239985Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2508.20210","last_updated":"2025-08-27T18:36:30Z","snapshot_observed_at":"2026-08-09T16:12:19.928163Z","submitted_at":"2025-08-27T18:36:30Z","title":"InfinityHuman: Towards Long-Term Audio-Driven Human","version":1},"reference_index":38,"source":"arxiv_source","source_observed_at":"2026-08-05T15:19:37.239985Z"},"links":{"cited_paper":"/paper/2504.04842","citing_paper":"/paper/2508.20210"},"observation_digest":"sha256:fa1ad1a6f61061bfd5927fba84f9fc8c49354a2a592ecd4849c53a60b9fc1727","observation_id":"5cf5dd96-bd4c-4fee-82a1-fe661de31133","resolution":{"observed_at":"2026-08-05T15:19:37.239985Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2504.04842","last_updated":"2025-04-07T08:56:01Z","snapshot_observed_at":"2026-08-09T02:00:54.345290Z","submitted_at":"2025-04-07T08:56:01Z","title":"FantasyTalking: Realistic Talking Portrait Generation via Coherent Motion Synthesis","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2504.04842","snapshot_observed_at":"2026-08-05T00:05:47.032525Z","title":"Fantasytalking: Realistic talking portrait generation via coherent motion synthesis.arXiv preprint arXiv:2504.04842, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2509.06155","last_updated":"2025-09-07T17:55:03Z","snapshot_observed_at":"2026-08-05T00:05:44.790684Z","submitted_at":"2025-09-07T17:55:03Z","title":"UniVerse-1: Unified Audio-Video Generation via Stitching of Experts","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-05T00:05:47.032525Z"},"links":{"cited_paper":"/paper/2504.04842","citing_paper":"/paper/2509.06155"},"observation_digest":"sha256:54233fb2352dedaa29e2ac6c0e3348eecfd46098740f20de8b82ff3075f74c51","observation_id":"20698b96-3e2e-44bb-8427-d1bfde1cc60e","resolution":{"observed_at":"2026-08-05T00:05:47.032525Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2504.04842","last_updated":"2025-04-07T08:56:01Z","snapshot_observed_at":"2026-08-09T02:00:54.345290Z","submitted_at":"2025-04-07T08:56:01Z","title":"FantasyTalking: Realistic Talking Portrait Generation via Coherent Motion Synthesis","version":1},"cited_work":{"arxiv_id":"2504.04842","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2504.04842","snapshot_observed_at":"2026-07-03T04:47:38.002589Z","title":"Fantasytalking: Realistic talking portrait generation via coherent motion synthesis","venue":null,"work_id":"b516fa8f-3f56-422f-bd2c-f6c785d1f6f5","year":2025},"citing_paper":{"arxiv_id":"2602.13669","last_updated":"2026-04-22T07:41:44Z","snapshot_observed_at":"2026-07-06T22:45:53.926021Z","submitted_at":"2026-02-14T08:32:38Z","title":"EchoTorrent: Towards Swift, Sustained, and Streaming Multi-Modal Video Generation","version":5},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-05-15T22:20:16.320171Z"},"links":{"cited_paper":"/paper/2504.04842","citing_paper":"/paper/2602.13669"},"observation_digest":"sha256:c24b5992e5f6a2db435f9b8400c16492a566c9473c87ac8291fc66baadda757a","observation_id":"1af6043e-009d-42fc-9d9a-2fc49a1ef10b","resolution":{"observed_at":"2026-05-15T22:20:22.475858Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2504.04842","last_updated":"2025-04-07T08:56:01Z","snapshot_observed_at":"2026-08-09T02:00:54.345290Z","submitted_at":"2025-04-07T08:56:01Z","title":"FantasyTalking: Realistic Talking Portrait Generation via Coherent Motion Synthesis","version":1},"cited_work":{"arxiv_id":"2504.04842","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2504.04842","snapshot_observed_at":"2026-07-03T04:47:38.002589Z","title":"Fantasytalking: Realistic talking portrait generation via coherent motion synthesis","venue":null,"work_id":"b516fa8f-3f56-422f-bd2c-f6c785d1f6f5","year":2025},"citing_paper":{"arxiv_id":"2604.08405","last_updated":"2026-07-30T09:16:54Z","snapshot_observed_at":"2026-08-03T01:34:12.626353Z","submitted_at":"2026-04-09T16:03:24Z","title":"SyncBreaker:Stage-Aware Multimodal Adversarial Attacks on Audio-Driven Talking Head Generation","version":2},"reference_index":52,"source":"pdf_text","source_observed_at":"2026-05-10T17:30:36.462567Z"},"links":{"cited_paper":"/paper/2504.04842","citing_paper":"/paper/2604.08405"},"observation_digest":"sha256:01bebf19b1f6bb7628c0a7f4bb4bed17f9e48f396b73a4ef5c9df1c7a7aca85d","observation_id":"7eb69972-41b0-4760-a2e1-582e119aa18a","resolution":{"observed_at":"2026-05-11T06:41:25.647082Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2504.04842","last_updated":"2025-04-07T08:56:01Z","snapshot_observed_at":"2026-08-09T02:00:54.345290Z","submitted_at":"2025-04-07T08:56:01Z","title":"FantasyTalking: Realistic Talking Portrait Generation via Coherent Motion Synthesis","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2504.04842","snapshot_observed_at":"2026-08-02T16:38:16.281646Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2604.08405","last_updated":"2026-07-30T09:16:54Z","snapshot_observed_at":"2026-08-03T01:34:12.626353Z","submitted_at":"2026-04-09T16:03:24Z","title":"SyncBreaker:Stage-Aware Multimodal Adversarial Attacks on Audio-Driven Talking Head Generation","version":3},"reference_index":52,"source":"pdf_text","source_observed_at":"2026-08-02T16:38:16.281646Z"},"links":{"cited_paper":"/paper/2504.04842","citing_paper":"/paper/2604.08405"},"observation_digest":"sha256:2e7a4718a0c4eeafba8e87f66db764b68d09938e7909bc1ddb6b2f403eb0b3e6","observation_id":"b7e51fbd-0484-4d2f-91ea-84d1b8cd8a89","resolution":{"observed_at":"2026-08-02T16:38:16.281646Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2504.04842","last_updated":"2025-04-07T08:56:01Z","snapshot_observed_at":"2026-08-09T02:00:54.345290Z","submitted_at":"2025-04-07T08:56:01Z","title":"FantasyTalking: Realistic Talking Portrait Generation via Coherent Motion Synthesis","version":1},"cited_work":{"arxiv_id":"2504.04842","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2504.04842","snapshot_observed_at":"2026-07-03T04:47:38.002589Z","title":"Fantasytalking: Realistic talking portrait generation via coherent motion synthesis","venue":null,"work_id":"b516fa8f-3f56-422f-bd2c-f6c785d1f6f5","year":2025},"citing_paper":{"arxiv_id":"2605.30230","last_updated":"2026-05-28T17:00:37Z","snapshot_observed_at":"2026-08-09T16:21:39.696026Z","submitted_at":"2026-05-28T17:00:37Z","title":"IP-Adapter Is All You Need: Towards Fine-Tuning-Free Diffusion-Based Talking Face Generation","version":1},"reference_index":38,"source":"pdf_text","source_observed_at":"2026-06-29T07:50:56.947671Z"},"links":{"cited_paper":"/paper/2504.04842","citing_paper":"/paper/2605.30230"},"observation_digest":"sha256:993e452178345df66c3fbbdb7a91828ef6ed48ecb3cafdb12c8bf712e2324932","observation_id":"84f34697-78db-4053-be6a-b312f29cfdf7","resolution":{"observed_at":"2026-06-29T07:53:13.382287Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2504.04842","last_updated":"2025-04-07T08:56:01Z","snapshot_observed_at":"2026-08-09T02:00:54.345290Z","submitted_at":"2025-04-07T08:56:01Z","title":"FantasyTalking: Realistic Talking Portrait Generation via Coherent Motion Synthesis","version":1},"cited_work":{"arxiv_id":"2504.04842","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2504.04842","snapshot_observed_at":"2026-07-03T04:47:38.002589Z","title":"Fantasytalking: Realistic talking portrait generation via coherent motion synthesis","venue":null,"work_id":"b516fa8f-3f56-422f-bd2c-f6c785d1f6f5","year":2025},"citing_paper":{"arxiv_id":"2606.11180","last_updated":"2026-06-09T17:56:36Z","snapshot_observed_at":"2026-08-05T12:57:25.376491Z","submitted_at":"2026-06-09T17:56:36Z","title":"Lip Forcing: Few-Step Autoregressive Diffusion for Real-time Lip Synchronization","version":1},"reference_index":42,"source":"pdf_text","source_observed_at":"2026-06-27T13:40:14.506288Z"},"links":{"cited_paper":"/paper/2504.04842","citing_paper":"/paper/2606.11180"},"observation_digest":"sha256:31b384b4c4d0f1cd5f6da558e147904018ac86c7aee214f506b5d1d983e611a0","observation_id":"e4248c7d-043e-479c-8756-e5a9f7725f6f","resolution":{"observed_at":"2026-07-03T04:47:38.004099Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2504.04842","last_updated":"2025-04-07T08:56:01Z","snapshot_observed_at":"2026-08-09T02:00:54.345290Z","submitted_at":"2025-04-07T08:56:01Z","title":"FantasyTalking: Realistic Talking Portrait Generation via Coherent Motion Synthesis","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2504.04842","snapshot_observed_at":"2026-08-04T01:32:13.185561Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2608.00079","last_updated":"2026-07-29T14:44:57Z","snapshot_observed_at":"2026-08-07T16:05:36.413106Z","submitted_at":"2026-07-29T14:44:57Z","title":"LeapTalk: Breaking the Latency-Quality Trade-off in Talking Head Generation","version":1},"reference_index":125,"source":"arxiv_source","source_observed_at":"2026-08-04T01:32:13.185561Z"},"links":{"cited_paper":"/paper/2504.04842","citing_paper":"/paper/2608.00079"},"observation_digest":"sha256:c6b94a5c217034c3246f4e7392e738fcdede2bca61a54ca43516f277add6a8da","observation_id":"ba0a8696-04c2-4358-970a-c6fa7f5bc396","resolution":{"observed_at":"2026-08-04T01:32:13.185561Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"links":{"evidence":"/evidence","html":"/paper/2504.04842/citation-record","integrity":"/paper/2504.04842/integrity","json":"/paper/2504.04842/citation-record.json","paper":"/paper/2504.04842"},"outbound":[],"paper":{"arxiv_id":"2504.04842","last_updated":"2025-04-07T08:56:01Z","latest_version":1,"primary_category":"cs.CV","snapshot_observed_at":"2026-08-09T02:00:54.345290Z","submitted_at":"2025-04-07T08:56:01Z","title":"FantasyTalking: Realistic Talking Portrait Generation via Coherent Motion Synthesis"},"reference_resolution":{"displayed":0,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":0,"verified_exact":0,"verified_fuzzy":0},"total_outbound_references":0},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"thesis":"As of 9 August 2026, this Paper Citation Record lists 0 of 0 outbound references and 17 inbound Pith citation observations for arXiv:2504.04842."}