{"as_of":"2026-08-10T14:59:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:1b91c0bbfd58965c1af7fed73439f745c8b12144b04d22e80284e085acbee2dd","coverage":[{"denominator":31,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":31,"source":"paper_references, paper_reference_links","source_observed_at":"2026-05-18T14:18:02.076576Z","state":"measured"},{"denominator":32,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":32,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-10T06:31:04.303077+00:00","state":"measured"},{"denominator":1,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":1,"source":"paper_references, paper_reference_links","source_observed_at":"2026-05-18T14:18:02.076576Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"pith","source_observed_at":"2026-05-18T14:21:28.416903Z","state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2509.20128","last_updated":"2026-04-11T06:13:45Z","snapshot_observed_at":"2026-07-06T22:30:41.141182Z","submitted_at":"2025-09-24T13:54:52Z","title":"KSDiff: Keyframe-Augmented Speech-Aware Dual-Path Diffusion for Facial Animation","version":2},"cited_work":{"arxiv_id":"2509.20128","doi":null,"metadata_source":"pith","pith_arxiv_id":"2509.20128","snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"KSDiff: Keyframe-Augmented Speech-Aware Dual-Path Diffusion for Facial Animation","venue":"cs.GR","work_id":"a477d2c1-e906-4446-961a-9deb0b9a08fa","year":2025},"citing_paper":{"arxiv_id":"2509.20128","last_updated":"2026-04-11T06:13:45Z","snapshot_observed_at":"2026-07-06T22:30:41.141182Z","submitted_at":"2025-09-24T13:54:52Z","title":"KSDiff: Keyframe-Augmented Speech-Aware Dual-Path Diffusion for Facial Animation","version":2},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-05-18T14:18:02.076576Z"},"links":{"cited_paper":"/paper/2509.20128","citing_paper":"/paper/2509.20128"},"observation_digest":"sha256:44db7a3d97bcd4bec71c9afcd01ab8edee943b47846d6fdce48fe778207c8a02","observation_id":"eb3ed498-689b-41fc-b7e1-efa123530228","resolution":{"observed_at":"2026-05-18T14:21:28.419042Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}}],"links":{"evidence":"/evidence","html":"/paper/2509.20128/citation-record","integrity":"/paper/2509.20128/integrity","json":"/paper/2509.20128/citation-record.json","paper":"/paper/2509.20128"},"outbound":[{"citation":{"cited_paper":{"arxiv_id":"2509.20128","last_updated":"2026-04-11T06:13:45Z","snapshot_observed_at":"2026-07-06T22:30:41.141182Z","submitted_at":"2025-09-24T13:54:52Z","title":"KSDiff: Keyframe-Augmented Speech-Aware Dual-Path Diffusion for Facial Animation","version":2},"cited_work":{"arxiv_id":"2509.20128","doi":null,"metadata_source":"pith","pith_arxiv_id":"2509.20128","snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"KSDiff: Keyframe-Augmented Speech-Aware Dual-Path Diffusion for Facial Animation","venue":"cs.GR","work_id":"a477d2c1-e906-4446-961a-9deb0b9a08fa","year":2025},"citing_paper":{"arxiv_id":"2509.20128","last_updated":"2026-04-11T06:13:45Z","snapshot_observed_at":"2026-07-06T22:30:41.141182Z","submitted_at":"2025-09-24T13:54:52Z","title":"KSDiff: Keyframe-Augmented Speech-Aware Dual-Path Diffusion for Facial Animation","version":2},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-05-18T14:18:02.076576Z"},"links":{"cited_paper":"/paper/2509.20128","citing_paper":"/paper/2509.20128"},"observation_digest":"sha256:44db7a3d97bcd4bec71c9afcd01ab8edee943b47846d6fdce48fe778207c8a02","observation_id":"eb3ed498-689b-41fc-b7e1-efa123530228","resolution":{"observed_at":"2026-05-18T14:21:28.419042Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":null,"venue":null,"work_id":"a628cc40-206e-4565-a2ba-98f831e468c7","year":null},"citing_paper":{"arxiv_id":"2509.20128","last_updated":"2026-04-11T06:13:45Z","snapshot_observed_at":"2026-07-06T22:30:41.141182Z","submitted_at":"2025-09-24T13:54:52Z","title":"KSDiff: Keyframe-Augmented Speech-Aware Dual-Path Diffusion for Facial Animation","version":2},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-05-18T14:18:02.076576Z"},"links":{"citing_paper":"/paper/2509.20128"},"observation_digest":"sha256:1149ab569b01a3a61b73091e4b5316784dd81ff58cd48d3f48867c8331522999","observation_id":"524236a2-c7a1-4ce4-893b-6c9f7f13bd94","resolution":{"observed_at":"2026-05-18T14:22:40.870577Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Dataset We train and evaluate our model on two benchmarks","venue":null,"work_id":"35628ab8-71f6-4bc7-8ed9-74d617fd282d","year":null},"citing_paper":{"arxiv_id":"2509.20128","last_updated":"2026-04-11T06:13:45Z","snapshot_observed_at":"2026-07-06T22:30:41.141182Z","submitted_at":"2025-09-24T13:54:52Z","title":"KSDiff: Keyframe-Augmented Speech-Aware Dual-Path Diffusion for Facial Animation","version":2},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-05-18T14:18:02.076576Z"},"links":{"citing_paper":"/paper/2509.20128"},"observation_digest":"sha256:f1fa355cc4b72bb2321381f317a7fa1e7067069e1149bdfdb6ad8e665965e953","observation_id":"14298c15-b4c2-4b14-ae3c-182f77e4ca19","resolution":{"observed_at":"2026-05-18T14:22:40.862010Z","resolver_source":"raw_fallback","status":"malformed_identifier"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":null,"venue":null,"work_id":"fa0f70ef-9e58-4485-8f63-5c3f2490a4f1","year":null},"citing_paper":{"arxiv_id":"2509.20128","last_updated":"2026-04-11T06:13:45Z","snapshot_observed_at":"2026-07-06T22:30:41.141182Z","submitted_at":"2025-09-24T13:54:52Z","title":"KSDiff: Keyframe-Augmented Speech-Aware Dual-Path Diffusion for Facial Animation","version":2},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-05-18T14:18:02.076576Z"},"links":{"citing_paper":"/paper/2509.20128"},"observation_digest":"sha256:1104b0ad20dc02bb87c1342bb2c2d14cf8713ee43f150ac5506edd16ee9735d7","observation_id":"d6425d6b-ceee-4d6f-8f3c-03fd823e1784","resolution":{"observed_at":"2026-05-18T14:22:40.865213Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":null,"venue":null,"work_id":"9dea35ee-f20e-4161-a06d-652c17d2444a","year":null},"citing_paper":{"arxiv_id":"2509.20128","last_updated":"2026-04-11T06:13:45Z","snapshot_observed_at":"2026-07-06T22:30:41.141182Z","submitted_at":"2025-09-24T13:54:52Z","title":"KSDiff: Keyframe-Augmented Speech-Aware Dual-Path Diffusion for Facial Animation","version":2},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-05-18T14:18:02.076576Z"},"links":{"citing_paper":"/paper/2509.20128"},"observation_digest":"sha256:f860f8fb433e81f3ba932bf8404fee5cf5d9874bda15f466c0fc864a8a9fbe71","observation_id":"1c9ed7f2-7038-438f-9ee1-122cb4a34e54","resolution":{"observed_at":"2026-05-18T14:22:40.823338Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Facediffuser: Speech- driven 3d facial animation synthesis using diffusion","venue":null,"work_id":"3b829a8e-4f90-4ef1-911d-4c6853250b47","year":2023},"citing_paper":{"arxiv_id":"2509.20128","last_updated":"2026-04-11T06:13:45Z","snapshot_observed_at":"2026-07-06T22:30:41.141182Z","submitted_at":"2025-09-24T13:54:52Z","title":"KSDiff: Keyframe-Augmented Speech-Aware Dual-Path Diffusion for Facial Animation","version":2},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-05-18T14:18:02.076576Z"},"links":{"citing_paper":"/paper/2509.20128"},"observation_digest":"sha256:f6fe2394b5c735c321a2871d43aeb23cf2e0298742907680c943f4b87e696ac1","observation_id":"fa464dfa-eaa9-437d-adbc-9de5b15d5c7f","resolution":{"observed_at":"2026-05-18T14:22:40.837800Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Difftalk: Crafting diffusion models for generalized audio- driven portraits animation","venue":null,"work_id":"de755872-e47b-4bc5-b18b-a959a3fe9b9e","year":2023},"citing_paper":{"arxiv_id":"2509.20128","last_updated":"2026-04-11T06:13:45Z","snapshot_observed_at":"2026-07-06T22:30:41.141182Z","submitted_at":"2025-09-24T13:54:52Z","title":"KSDiff: Keyframe-Augmented Speech-Aware Dual-Path Diffusion for Facial Animation","version":2},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-05-18T14:18:02.076576Z"},"links":{"citing_paper":"/paper/2509.20128"},"observation_digest":"sha256:535c23f12826b3c1516c236fddf9953f0ec2687f84d5290d6c09f0c06ede639a","observation_id":"1223e6a9-01d4-4471-8fd8-0e2ba71ed2f5","resolution":{"observed_at":"2026-05-18T14:22:40.809585Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2402.05712","last_updated":"2024-02-08T14:39:16Z","snapshot_observed_at":"2026-08-04T13:02:13.622096Z","submitted_at":"2024-02-08T14:39:16Z","title":"DiffSpeaker: Speech-Driven 3D Facial Animation with Diffusion Transformer","version":1},"cited_work":{"arxiv_id":"2402.05712","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2402.05712","snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Diffs- peaker: Speech-driven 3d facial animation with diffusion trans- former","venue":null,"work_id":"0788dd02-e888-4bab-89e0-ce9d71636547","year":2024},"citing_paper":{"arxiv_id":"2509.20128","last_updated":"2026-04-11T06:13:45Z","snapshot_observed_at":"2026-07-06T22:30:41.141182Z","submitted_at":"2025-09-24T13:54:52Z","title":"KSDiff: Keyframe-Augmented Speech-Aware Dual-Path Diffusion for Facial Animation","version":2},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-05-18T14:18:02.076576Z"},"links":{"cited_paper":"/paper/2402.05712","citing_paper":"/paper/2509.20128"},"observation_digest":"sha256:add026c6dc58ecfea9d6f87465812b91aee94610387af24bf260870a8e9816a5","observation_id":"56562c9d-a4e3-488b-9d83-2ceeb5410941","resolution":{"observed_at":"2026-05-18T14:21:28.415049Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Emotivetalk: Ex- pressive talking head generation through audio information de- coupling and emotional video diffusion","venue":null,"work_id":"808861e5-1975-4612-9eed-2c6f73342b76","year":2025},"citing_paper":{"arxiv_id":"2509.20128","last_updated":"2026-04-11T06:13:45Z","snapshot_observed_at":"2026-07-06T22:30:41.141182Z","submitted_at":"2025-09-24T13:54:52Z","title":"KSDiff: Keyframe-Augmented Speech-Aware Dual-Path Diffusion for Facial Animation","version":2},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-05-18T14:18:02.076576Z"},"links":{"citing_paper":"/paper/2509.20128"},"observation_digest":"sha256:821062ec946ebe79ce270f5fef2f6c3b9b5c29d805cb52cbb73e5a9005d20f8d","observation_id":"7d31c9a5-3cca-4099-9c66-8b439395e30b","resolution":{"observed_at":"2026-05-18T14:22:40.805335Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Sadtalker: Learning realistic 3d motion coefficients for stylized audio-driven single image talking face animation","venue":null,"work_id":"e8fcd689-9814-44ae-b6bb-f7b343d0cfe3","year":2023},"citing_paper":{"arxiv_id":"2509.20128","last_updated":"2026-04-11T06:13:45Z","snapshot_observed_at":"2026-07-06T22:30:41.141182Z","submitted_at":"2025-09-24T13:54:52Z","title":"KSDiff: Keyframe-Augmented Speech-Aware Dual-Path Diffusion for Facial Animation","version":2},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-05-18T14:18:02.076576Z"},"links":{"citing_paper":"/paper/2509.20128"},"observation_digest":"sha256:bb054d793c187b0a8986764e51b2cfc8f8fdab5e7978ad4b2fc8cc5719c50b49","observation_id":"eefb76c7-2aeb-43b9-8a5b-05ef2b929d1f","resolution":{"observed_at":"2026-05-18T14:22:40.799341Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Synctalk: The devil is in the synchro- nization for talking head synthesis","venue":null,"work_id":"c9b7766a-702c-4b00-9ad8-6b6a1df023a6","year":2024},"citing_paper":{"arxiv_id":"2509.20128","last_updated":"2026-04-11T06:13:45Z","snapshot_observed_at":"2026-07-06T22:30:41.141182Z","submitted_at":"2025-09-24T13:54:52Z","title":"KSDiff: Keyframe-Augmented Speech-Aware Dual-Path Diffusion for Facial Animation","version":2},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-05-18T14:18:02.076576Z"},"links":{"citing_paper":"/paper/2509.20128"},"observation_digest":"sha256:387b1923b05b1136802541a966f08444212adf18bf658c3e49ccec13678a5c2d","observation_id":"4c23ca70-4119-46f6-b3f5-e1dbc91596bf","resolution":{"observed_at":"2026-05-18T14:22:40.924511Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Prosodytalker: 3d visual speech animation via prosody de- composition","venue":null,"work_id":"34394c0e-b494-41ca-b013-62b349048cfd","year":2025},"citing_paper":{"arxiv_id":"2509.20128","last_updated":"2026-04-11T06:13:45Z","snapshot_observed_at":"2026-07-06T22:30:41.141182Z","submitted_at":"2025-09-24T13:54:52Z","title":"KSDiff: Keyframe-Augmented Speech-Aware Dual-Path Diffusion for Facial Animation","version":2},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-05-18T14:18:02.076576Z"},"links":{"citing_paper":"/paper/2509.20128"},"observation_digest":"sha256:17b305ad2c62e0bcc7ae8dc7620acbc223ee5a79eb2709a3393ac7dbc51916d8","observation_id":"4075752b-5b85-4d09-bc8e-aba6af630474","resolution":{"observed_at":"2026-05-18T14:22:40.920557Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Keyface: Expressive audio-driven facial animation for long sequences via keyframe interpolation","venue":null,"work_id":"3cd192c5-5722-4b0c-aeed-6eb0766303e7","year":2025},"citing_paper":{"arxiv_id":"2509.20128","last_updated":"2026-04-11T06:13:45Z","snapshot_observed_at":"2026-07-06T22:30:41.141182Z","submitted_at":"2025-09-24T13:54:52Z","title":"KSDiff: Keyframe-Augmented Speech-Aware Dual-Path Diffusion for Facial Animation","version":2},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-05-18T14:18:02.076576Z"},"links":{"citing_paper":"/paper/2509.20128"},"observation_digest":"sha256:cf39cbbc3feccb3c5e85eacd53988f80c15e383a5ef5903978caddafb415a43d","observation_id":"41225913-770f-4596-b402-a9bcc0d97999","resolution":{"observed_at":"2026-05-18T14:22:40.916558Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Speak: Speech-driven pose and emotion- adjustable talking head generation","venue":null,"work_id":"5c4e85d4-0999-4289-828f-67c6bc2aaaf4","year":2025},"citing_paper":{"arxiv_id":"2509.20128","last_updated":"2026-04-11T06:13:45Z","snapshot_observed_at":"2026-07-06T22:30:41.141182Z","submitted_at":"2025-09-24T13:54:52Z","title":"KSDiff: Keyframe-Augmented Speech-Aware Dual-Path Diffusion for Facial Animation","version":2},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-05-18T14:18:02.076576Z"},"links":{"citing_paper":"/paper/2509.20128"},"observation_digest":"sha256:09553e38a61291d6859afe0c7a3dd15f6219855b6b0e8dd74d2e197c80e4324b","observation_id":"a7a3b5e2-9c9c-4751-a504-daf40d7dae21","resolution":{"observed_at":"2026-05-18T14:22:40.913070Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Fd2talk: Towards gener- alized talking head generation with facial decoupled diffusion model","venue":null,"work_id":"fe183561-b4ee-4fab-a44f-d84e8cb84426","year":2024},"citing_paper":{"arxiv_id":"2509.20128","last_updated":"2026-04-11T06:13:45Z","snapshot_observed_at":"2026-07-06T22:30:41.141182Z","submitted_at":"2025-09-24T13:54:52Z","title":"KSDiff: Keyframe-Augmented Speech-Aware Dual-Path Diffusion for Facial Animation","version":2},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-05-18T14:18:02.076576Z"},"links":{"citing_paper":"/paper/2509.20128"},"observation_digest":"sha256:0380607d4466d73912ba92cb726aefd2bb49165f8fa00dcf952e5da5a9797121","observation_id":"29bd2907-6bf2-4142-8af7-a179eb30449d","resolution":{"observed_at":"2026-05-18T14:22:40.909664Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Learning an animatable detailed 3d face model from in-the-wild images","venue":null,"work_id":"e0a3f84b-faab-4269-9899-5f82d77abdcf","year":2021},"citing_paper":{"arxiv_id":"2509.20128","last_updated":"2026-04-11T06:13:45Z","snapshot_observed_at":"2026-07-06T22:30:41.141182Z","submitted_at":"2025-09-24T13:54:52Z","title":"KSDiff: Keyframe-Augmented Speech-Aware Dual-Path Diffusion for Facial Animation","version":2},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-05-18T14:18:02.076576Z"},"links":{"citing_paper":"/paper/2509.20128"},"observation_digest":"sha256:f2c7a0ccce368d2e437abbff548c5a6bd12625222bd94fcce5a88383b728ecf9","observation_id":"e66ee7f3-c55a-4a14-8053-eb40964e37bd","resolution":{"observed_at":"2026-05-18T14:22:40.905080Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Disco- head: audio-and-video-driven talking head generation by dis- entangled control of head pose and facial expressions","venue":null,"work_id":"46e014bb-9e62-4da4-bda6-c0ec93480a02","year":2023},"citing_paper":{"arxiv_id":"2509.20128","last_updated":"2026-04-11T06:13:45Z","snapshot_observed_at":"2026-07-06T22:30:41.141182Z","submitted_at":"2025-09-24T13:54:52Z","title":"KSDiff: Keyframe-Augmented Speech-Aware Dual-Path Diffusion for Facial Animation","version":2},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-05-18T14:18:02.076576Z"},"links":{"citing_paper":"/paper/2509.20128"},"observation_digest":"sha256:d3f487e8ccc3facf0ec2998229be95e712b596e67f23c1a3c3877954fb854bb4","observation_id":"da8c9033-b841-4664-b959-90a603d48439","resolution":{"observed_at":"2026-05-18T14:22:40.900229Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Nerf-3dtalker: Neural radiance field with 3d prior aided audio disentanglement for talking head syn- thesis","venue":null,"work_id":"f4e801e0-94c8-4e3b-9291-8568183ffc49","year":2025},"citing_paper":{"arxiv_id":"2509.20128","last_updated":"2026-04-11T06:13:45Z","snapshot_observed_at":"2026-07-06T22:30:41.141182Z","submitted_at":"2025-09-24T13:54:52Z","title":"KSDiff: Keyframe-Augmented Speech-Aware Dual-Path Diffusion for Facial Animation","version":2},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-05-18T14:18:02.076576Z"},"links":{"citing_paper":"/paper/2509.20128"},"observation_digest":"sha256:91a8d7ce77dfc15b623e945159fea2bf896a921603ffa5ef1d6f767dfcbdcba8","observation_id":"8f62fb29-327d-45b3-98ca-ec67218cc8bd","resolution":{"observed_at":"2026-05-18T14:22:40.896595Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"wav2vec: Unsupervised pre-training for speech recognition","venue":null,"work_id":"0cd9bcac-c589-471a-b591-618e051db627","year":2019},"citing_paper":{"arxiv_id":"2509.20128","last_updated":"2026-04-11T06:13:45Z","snapshot_observed_at":"2026-07-06T22:30:41.141182Z","submitted_at":"2025-09-24T13:54:52Z","title":"KSDiff: Keyframe-Augmented Speech-Aware Dual-Path Diffusion for Facial Animation","version":2},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-05-18T14:18:02.076576Z"},"links":{"citing_paper":"/paper/2509.20128"},"observation_digest":"sha256:5a435a924fcdad2d886ad916a7eb4193a037e83e6dc3f44e068bf844d162be21","observation_id":"8ab9707f-82e6-449a-82c1-25603f0328b2","resolution":{"observed_at":"2026-05-18T14:22:40.892830Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Spsinger: Multi-singer singing voice synthesis with short reference prompt","venue":null,"work_id":"c5b3e4ef-4cbc-4bd5-9394-82b4a5224f26","year":2025},"citing_paper":{"arxiv_id":"2509.20128","last_updated":"2026-04-11T06:13:45Z","snapshot_observed_at":"2026-07-06T22:30:41.141182Z","submitted_at":"2025-09-24T13:54:52Z","title":"KSDiff: Keyframe-Augmented Speech-Aware Dual-Path Diffusion for Facial Animation","version":2},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-05-18T14:18:02.076576Z"},"links":{"citing_paper":"/paper/2509.20128"},"observation_digest":"sha256:a681bac154a475917b9287d0f6af24cbff6fd2a66646029c0b609870c1cc53f2","observation_id":"dc6a7aa7-8566-4c2b-9638-1c258428a924","resolution":{"observed_at":"2026-05-18T14:22:40.887342Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Prosody-Adaptable Audio Codecs for Zero-Shot V oice Conversion via In-Context Learn- ing","venue":null,"work_id":"fb8372ff-93b8-48d6-8e3c-74bc9568e5d1","year":2025},"citing_paper":{"arxiv_id":"2509.20128","last_updated":"2026-04-11T06:13:45Z","snapshot_observed_at":"2026-07-06T22:30:41.141182Z","submitted_at":"2025-09-24T13:54:52Z","title":"KSDiff: Keyframe-Augmented Speech-Aware Dual-Path Diffusion for Facial Animation","version":2},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-05-18T14:18:02.076576Z"},"links":{"citing_paper":"/paper/2509.20128"},"observation_digest":"sha256:e03ccf7fb4822e652d0efdbde61ed29b9efafe82c0c1d2cf69c0debe7e11d860","observation_id":"c2560861-549d-47fe-b38d-d0a98e250f28","resolution":{"observed_at":"2026-05-18T14:22:40.883688Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Film: Visual reasoning with a general conditioning layer","venue":null,"work_id":"97c6a317-10ff-495b-ab49-93d7844d6cee","year":2018},"citing_paper":{"arxiv_id":"2509.20128","last_updated":"2026-04-11T06:13:45Z","snapshot_observed_at":"2026-07-06T22:30:41.141182Z","submitted_at":"2025-09-24T13:54:52Z","title":"KSDiff: Keyframe-Augmented Speech-Aware Dual-Path Diffusion for Facial Animation","version":2},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-05-18T14:18:02.076576Z"},"links":{"citing_paper":"/paper/2509.20128"},"observation_digest":"sha256:3e67568527e02335edfe954278f22057c3547d1d2efb14863c64e1b5c5bd588d","observation_id":"26b28b96-2fd3-445b-bf14-db9b433fe9bc","resolution":{"observed_at":"2026-05-18T14:22:40.879932Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Improved parallel wavegan vocoder with per- ceptually weighted spectrogram loss","venue":null,"work_id":"32ef8a45-249d-4f7f-a62d-07dc28ebef6b","year":2021},"citing_paper":{"arxiv_id":"2509.20128","last_updated":"2026-04-11T06:13:45Z","snapshot_observed_at":"2026-07-06T22:30:41.141182Z","submitted_at":"2025-09-24T13:54:52Z","title":"KSDiff: Keyframe-Augmented Speech-Aware Dual-Path Diffusion for Facial Animation","version":2},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-05-18T14:18:02.076576Z"},"links":{"citing_paper":"/paper/2509.20128"},"observation_digest":"sha256:771b31c39febf07938095d9181d096064ae72fee37382b53fb2d0030f3e3c384","observation_id":"164b0662-aa5c-47ac-9d5a-6e6e0e64ecd4","resolution":{"observed_at":"2026-05-18T14:22:40.876106Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Flow-guided one- shot talking face generation with a high-resolution audio-visual dataset","venue":null,"work_id":"23212dd3-62ba-4204-a257-492082cbede6","year":2021},"citing_paper":{"arxiv_id":"2509.20128","last_updated":"2026-04-11T06:13:45Z","snapshot_observed_at":"2026-07-06T22:30:41.141182Z","submitted_at":"2025-09-24T13:54:52Z","title":"KSDiff: Keyframe-Augmented Speech-Aware Dual-Path Diffusion for Facial Animation","version":2},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-05-18T14:18:02.076576Z"},"links":{"citing_paper":"/paper/2509.20128"},"observation_digest":"sha256:a7e0b45cc3cef9e94652d9114458948b00238f5ef0b9865b8356e61496ba2f2a","observation_id":"6dc7dfbd-83c9-44a3-80c8-a88b3a5dfee1","resolution":{"observed_at":"2026-05-18T14:22:40.871754Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"V oxceleb: A large-scale speaker identification dataset","venue":null,"work_id":"9e4dd6c1-f991-4ed0-bebf-ac0b882ae576","year":2017},"citing_paper":{"arxiv_id":"2509.20128","last_updated":"2026-04-11T06:13:45Z","snapshot_observed_at":"2026-07-06T22:30:41.141182Z","submitted_at":"2025-09-24T13:54:52Z","title":"KSDiff: Keyframe-Augmented Speech-Aware Dual-Path Diffusion for Facial Animation","version":2},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-05-18T14:18:02.076576Z"},"links":{"citing_paper":"/paper/2509.20128"},"observation_digest":"sha256:1ecb96b44bd7ae34d66863f52c7d29a2d9f8d77233955c214f711b0726e797d9","observation_id":"19b246d7-0020-49fd-8cf5-9eb74c6546ec","resolution":{"observed_at":"2026-05-18T14:22:40.864861Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Hallo2: Long-duration and high- resolution audio-driven portrait image animation","venue":null,"work_id":"b878b83e-149a-4cc3-8667-72da0347eaba","year":2025},"citing_paper":{"arxiv_id":"2509.20128","last_updated":"2026-04-11T06:13:45Z","snapshot_observed_at":"2026-07-06T22:30:41.141182Z","submitted_at":"2025-09-24T13:54:52Z","title":"KSDiff: Keyframe-Augmented Speech-Aware Dual-Path Diffusion for Facial Animation","version":2},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-05-18T14:18:02.076576Z"},"links":{"citing_paper":"/paper/2509.20128"},"observation_digest":"sha256:57c0d44eb5c41ed8ca8fbe775ac86f1c7d45ad1615cf090988c485e288b8176e","observation_id":"4baf7e6b-bcc6-4e7e-b8d3-eabe5609d273","resolution":{"observed_at":"2026-05-18T14:22:40.859854Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Meshtalk: 3d face animation from speech using cross- modality disentanglement","venue":null,"work_id":"6b7e3141-fb60-43f9-978c-751570b0ac6f","year":2021},"citing_paper":{"arxiv_id":"2509.20128","last_updated":"2026-04-11T06:13:45Z","snapshot_observed_at":"2026-07-06T22:30:41.141182Z","submitted_at":"2025-09-24T13:54:52Z","title":"KSDiff: Keyframe-Augmented Speech-Aware Dual-Path Diffusion for Facial Animation","version":2},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-05-18T14:18:02.076576Z"},"links":{"citing_paper":"/paper/2509.20128"},"observation_digest":"sha256:59369c7187e8b78cd97f560e36b81afeada25c0ae709766e40ac00377b291c7d","observation_id":"026f25cf-ed6c-4621-b2cc-8d4f843ab51b","resolution":{"observed_at":"2026-05-18T14:22:40.852453Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"A lip sync expert is all you need for speech to lip generation in the wild","venue":null,"work_id":"c4e5c1f4-cbf8-4c59-a1d3-9e622acce1f5","year":2020},"citing_paper":{"arxiv_id":"2509.20128","last_updated":"2026-04-11T06:13:45Z","snapshot_observed_at":"2026-07-06T22:30:41.141182Z","submitted_at":"2025-09-24T13:54:52Z","title":"KSDiff: Keyframe-Augmented Speech-Aware Dual-Path Diffusion for Facial Animation","version":2},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-05-18T14:18:02.076576Z"},"links":{"citing_paper":"/paper/2509.20128"},"observation_digest":"sha256:07f534b2801c35f71f5c8e1d8a950b4598ee5486eb581040142f555b75dafe73","observation_id":"daca2d65-86e7-47af-9fb2-7760c3dbc0d6","resolution":{"observed_at":"2026-05-18T14:22:40.848920Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Fine-grained head pose estimation without keypoints","venue":null,"work_id":"e73f29c7-095b-4984-9400-47be4b8b202d","year":2018},"citing_paper":{"arxiv_id":"2509.20128","last_updated":"2026-04-11T06:13:45Z","snapshot_observed_at":"2026-07-06T22:30:41.141182Z","submitted_at":"2025-09-24T13:54:52Z","title":"KSDiff: Keyframe-Augmented Speech-Aware Dual-Path Diffusion for Facial Animation","version":2},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-05-18T14:18:02.076576Z"},"links":{"citing_paper":"/paper/2509.20128"},"observation_digest":"sha256:a33549405afb7d1913b23a0ced74fd053e4fd183013370654afcc8b88feba522","observation_id":"ec6bad9b-95f9-479c-afbb-ac19f0b4c697","resolution":{"observed_at":"2026-05-18T14:22:40.844160Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Bailando: 3d dance generation by actor- critic gpt with choreographic memory","venue":null,"work_id":"8549da36-bdbe-4c85-a6b0-cb7620e4bbae","year":2022},"citing_paper":{"arxiv_id":"2509.20128","last_updated":"2026-04-11T06:13:45Z","snapshot_observed_at":"2026-07-06T22:30:41.141182Z","submitted_at":"2025-09-24T13:54:52Z","title":"KSDiff: Keyframe-Augmented Speech-Aware Dual-Path Diffusion for Facial Animation","version":2},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-05-18T14:18:02.076576Z"},"links":{"citing_paper":"/paper/2509.20128"},"observation_digest":"sha256:15b5cc9eca27832c786201679fab225ba64dc5f3ccccdddd8f40416ea07ee8bc","observation_id":"21fcfb77-80ee-4ee8-93a2-68dfb07fc2cf","resolution":{"observed_at":"2026-05-18T14:22:40.839699Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Robust speech recognition via large-scale weak supervision","venue":null,"work_id":"5c58086a-6b07-45dd-91ae-a5b7b04161ca","year":2023},"citing_paper":{"arxiv_id":"2509.20128","last_updated":"2026-04-11T06:13:45Z","snapshot_observed_at":"2026-07-06T22:30:41.141182Z","submitted_at":"2025-09-24T13:54:52Z","title":"KSDiff: Keyframe-Augmented Speech-Aware Dual-Path Diffusion for Facial Animation","version":2},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-05-18T14:18:02.076576Z"},"links":{"citing_paper":"/paper/2509.20128"},"observation_digest":"sha256:89fc77c457f1e5682e1d213c98257b9f0aea66e8d34d7dd086d62a0550ce0f54","observation_id":"0241366b-e474-4b36-be55-2c3d835f8e63","resolution":{"observed_at":"2026-05-18T14:22:40.836070Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}}],"paper":{"arxiv_id":"2509.20128","last_updated":"2026-04-11T06:13:45Z","latest_version":2,"primary_category":"cs.GR","snapshot_observed_at":"2026-07-06T22:30:41.141182Z","submitted_at":"2025-09-24T13:54:52Z","title":"KSDiff: Keyframe-Augmented Speech-Aware Dual-Path Diffusion for Facial Animation"},"reference_resolution":{"displayed":31,"state_counts":{"malformed_identifier":1,"metadata_mismatch":1,"parse_uncertain":0,"unresolved":3,"verified_exact":1,"verified_fuzzy":25},"total_outbound_references":31},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"thesis":"As of 10 August 2026, this Paper Citation Record lists 31 of 31 outbound references and 1 inbound Pith citation observation for arXiv:2509.20128."}