{"as_of":"2026-08-19T03:52:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:0241704ddc48a7f469e8c1cf726fa53fa603fa03c6ec0bcb33e834a377378ea7","coverage":[{"denominator":42,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":42,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-11T12:58:33.169463Z","state":"measured"},{"denominator":42,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":42,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-18T06:34:40.430872+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2412.13656/citation-record","integrity":"/paper/2412.13656/integrity","json":"/paper/2412.13656/citation-record.json","paper":"/paper/2412.13656"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T12:58:32.726745Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2412.13656","last_updated":"2025-02-24T06:29:16Z","snapshot_observed_at":"2026-08-18T03:36:38.145712Z","submitted_at":"2024-12-18T09:34:59Z","title":"GLCF: A Global-Local Multimodal Coherence Analysis Framework for Talking Face Generation Detection","version":2},"reference_index":1,"source":"arxiv_source","source_observed_at":"2026-08-11T12:58:32.726745Z"},"links":{"citing_paper":"/paper/2412.13656"},"observation_digest":"sha256:e317c91987fdca583c7fd5eab7c871c2f28132da343f253004cdaf776774e0cd","observation_id":"403c8a28-b8e5-4ee2-85d8-49d88f22eaad","resolution":{"observed_at":"2026-08-11T12:58:32.726745Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T12:58:34.311130Z","title":null,"venue":null,"work_id":"14c99b6a-4000-4aa4-8ce8-9443b9af3a46","year":2023},"citing_paper":{"arxiv_id":"2412.13656","last_updated":"2025-02-24T06:29:16Z","snapshot_observed_at":"2026-08-18T03:36:38.145712Z","submitted_at":"2024-12-18T09:34:59Z","title":"GLCF: A Global-Local Multimodal Coherence Analysis Framework for Talking Face Generation Detection","version":2},"reference_index":2,"source":"arxiv_source","source_observed_at":"2026-08-11T12:58:32.731120Z"},"links":{"citing_paper":"/paper/2412.13656"},"observation_digest":"sha256:bdc23f36522771a39c2af732100a268a20ddc7fd14b3539a78f3e5d62d005c46","observation_id":"e4a750e3-5fc3-44f3-8a14-a1a2f0b4760c","resolution":{"observed_at":"2026-08-11T12:58:34.315841Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T12:58:34.228014Z","title":"G.; Keutmann, M","venue":null,"work_id":"8b5f4a7d-2525-4df1-89d8-44e3599264bd","year":2014},"citing_paper":{"arxiv_id":"2412.13656","last_updated":"2025-02-24T06:29:16Z","snapshot_observed_at":"2026-08-18T03:36:38.145712Z","submitted_at":"2024-12-18T09:34:59Z","title":"GLCF: A Global-Local Multimodal Coherence Analysis Framework for Talking Face Generation Detection","version":2},"reference_index":3,"source":"arxiv_source","source_observed_at":"2026-08-11T12:58:32.734790Z"},"links":{"citing_paper":"/paper/2412.13656"},"observation_digest":"sha256:0ebefd76c3378fae2bc9f43f75901a7fc93a353ae60aa79e1749f7358011d502","observation_id":"1e1c6748-9d4c-4e66-81ac-47f0e8319d42","resolution":{"observed_at":"2026-08-11T12:58:34.303795Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T12:58:32.738851Z","title":null,"venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2412.13656","last_updated":"2025-02-24T06:29:16Z","snapshot_observed_at":"2026-08-18T03:36:38.145712Z","submitted_at":"2024-12-18T09:34:59Z","title":"GLCF: A Global-Local Multimodal Coherence Analysis Framework for Talking Face Generation Detection","version":2},"reference_index":4,"source":"arxiv_source","source_observed_at":"2026-08-11T12:58:32.738851Z"},"links":{"citing_paper":"/paper/2412.13656"},"observation_digest":"sha256:7521baebef758aecbe61c1c82631d44ce149b3c68912e674a1cd010316cfe789","observation_id":"7846c1dc-00fd-4bc0-b691-447cdb708b16","resolution":{"observed_at":"2026-08-11T12:58:32.738851Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2310.05720","last_updated":"2023-10-15T02:28:43Z","snapshot_observed_at":"2026-08-18T03:37:14.820120Z","submitted_at":"2023-10-09T13:45:21Z","title":"HyperLips: Hyper Control Lips with High Resolution Decoder for Talking Face Generation","version":3},"cited_work":{"arxiv_id":"2310.05720","doi":null,"metadata_source":"pith","pith_arxiv_id":"2310.05720","snapshot_observed_at":"2026-08-11T12:58:33.288926Z","title":"HyperLips: Hyper Control Lips with High Resolution Decoder for Talking Face Generation","venue":"cs.CV","work_id":"fa34f207-462e-436a-bf6a-0723d99a6464","year":2023},"citing_paper":{"arxiv_id":"2412.13656","last_updated":"2025-02-24T06:29:16Z","snapshot_observed_at":"2026-08-18T03:36:38.145712Z","submitted_at":"2024-12-18T09:34:59Z","title":"GLCF: A Global-Local Multimodal Coherence Analysis Framework for Talking Face Generation Detection","version":2},"reference_index":5,"source":"arxiv_source","source_observed_at":"2026-08-11T12:58:32.743080Z"},"links":{"cited_paper":"/paper/2310.05720","citing_paper":"/paper/2412.13656"},"observation_digest":"sha256:aa39c06c18583c144d058c53198878454607e436bdc7a6a30b1ff1dc873f8490","observation_id":"e9b94e7b-f332-46a4-b377-6c055221ff38","resolution":{"observed_at":"2026-08-11T12:58:33.319045Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T12:58:34.173248Z","title":null,"venue":null,"work_id":"64609e38-59f7-44a3-8ecc-1e7d5815b71a","year":2022},"citing_paper":{"arxiv_id":"2412.13656","last_updated":"2025-02-24T06:29:16Z","snapshot_observed_at":"2026-08-18T03:36:38.145712Z","submitted_at":"2024-12-18T09:34:59Z","title":"GLCF: A Global-Local Multimodal Coherence Analysis Framework for Talking Face Generation Detection","version":2},"reference_index":6,"source":"arxiv_source","source_observed_at":"2026-08-11T12:58:32.746693Z"},"links":{"citing_paper":"/paper/2412.13656"},"observation_digest":"sha256:87d91a1ee5a21ca66b51ccd586bcc81845a8ee5c53a089ff2ed97195d99d19f6","observation_id":"463fe4f7-85e2-4a53-9ad8-6271f9758b6d","resolution":{"observed_at":"2026-08-11T12:58:34.175620Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1806.05622","last_updated":"2018-06-27T01:49:17Z","snapshot_observed_at":"2026-08-15T02:39:00.334605Z","submitted_at":"2018-06-14T15:59:12Z","title":"VoxCeleb2: Deep Speaker Recognition","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1806.05622","snapshot_observed_at":"2026-08-11T12:58:32.750132Z","title":"S.; Nagrani, A.; and Zisserman, A","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2412.13656","last_updated":"2025-02-24T06:29:16Z","snapshot_observed_at":"2026-08-18T03:36:38.145712Z","submitted_at":"2024-12-18T09:34:59Z","title":"GLCF: A Global-Local Multimodal Coherence Analysis Framework for Talking Face Generation Detection","version":2},"reference_index":7,"source":"arxiv_source","source_observed_at":"2026-08-11T12:58:32.750132Z"},"links":{"cited_paper":"/paper/1806.05622","citing_paper":"/paper/2412.13656"},"observation_digest":"sha256:7bf7dd32272e047247bc622774d657108f0a14fbf280ec26916de28d8b0afdc6","observation_id":"3aaf091b-2135-4f5a-a934-fcc704ee6dc2","resolution":{"observed_at":"2026-08-11T12:58:32.750132Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2006.07397","last_updated":"2020-10-28T03:48:28Z","snapshot_observed_at":"2026-07-06T09:28:36.954658Z","submitted_at":"2020-06-12T18:15:55Z","title":"The DeepFake Detection Challenge (DFDC) Dataset","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2006.07397","snapshot_observed_at":"2026-08-11T12:58:32.754670Z","title":null,"venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2412.13656","last_updated":"2025-02-24T06:29:16Z","snapshot_observed_at":"2026-08-18T03:36:38.145712Z","submitted_at":"2024-12-18T09:34:59Z","title":"GLCF: A Global-Local Multimodal Coherence Analysis Framework for Talking Face Generation Detection","version":2},"reference_index":8,"source":"arxiv_source","source_observed_at":"2026-08-11T12:58:32.754670Z"},"links":{"cited_paper":"/paper/2006.07397","citing_paper":"/paper/2412.13656"},"observation_digest":"sha256:7fbf8106e53c69d70f8c8a2d53d02d15336892c30f5bdc7dc6cdcf6cb17dcc22","observation_id":"8a0c4934-9785-4660-9557-6cb85fd9e2c4","resolution":{"observed_at":"2026-08-11T12:58:32.754670Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T12:58:34.165725Z","title":null,"venue":null,"work_id":"0aa1c83e-982d-4f68-a06a-40f1b836813c","year":2023},"citing_paper":{"arxiv_id":"2412.13656","last_updated":"2025-02-24T06:29:16Z","snapshot_observed_at":"2026-08-18T03:36:38.145712Z","submitted_at":"2024-12-18T09:34:59Z","title":"GLCF: A Global-Local Multimodal Coherence Analysis Framework for Talking Face Generation Detection","version":2},"reference_index":9,"source":"arxiv_source","source_observed_at":"2026-08-11T12:58:32.757538Z"},"links":{"citing_paper":"/paper/2412.13656"},"observation_digest":"sha256:0064f3c5554ab0d13adbfc8c309b94ce6328c320f9c2f84df5b648e815d1f659","observation_id":"ce9a98d9-154e-479b-9c1b-7f3c9cab952a","resolution":{"observed_at":"2026-08-11T12:58:34.167896Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2111.02813","last_updated":"2021-11-04T12:26:34Z","snapshot_observed_at":"2026-08-18T06:21:12.766256Z","submitted_at":"2021-11-04T12:26:34Z","title":"WaveFake: A Data Set to Facilitate Audio Deepfake Detection","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2111.02813","snapshot_observed_at":"2026-08-11T12:58:32.760603Z","title":null,"venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2412.13656","last_updated":"2025-02-24T06:29:16Z","snapshot_observed_at":"2026-08-18T03:36:38.145712Z","submitted_at":"2024-12-18T09:34:59Z","title":"GLCF: A Global-Local Multimodal Coherence Analysis Framework for Talking Face Generation Detection","version":2},"reference_index":10,"source":"arxiv_source","source_observed_at":"2026-08-11T12:58:32.760603Z"},"links":{"cited_paper":"/paper/2111.02813","citing_paper":"/paper/2412.13656"},"observation_digest":"sha256:6636eb81aec8c2df0e5216fc2f2b5a5617a4d49bc4280684af27bc7e2a69609a","observation_id":"e14c7676-0a0f-4aa0-9c9f-d48c448e4170","resolution":{"observed_at":"2026-08-11T12:58:32.760603Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T12:58:34.131586Z","title":null,"venue":null,"work_id":"0cb66004-7a3e-4bf0-8813-0cc4888deb36","year":2020},"citing_paper":{"arxiv_id":"2412.13656","last_updated":"2025-02-24T06:29:16Z","snapshot_observed_at":"2026-08-18T03:36:38.145712Z","submitted_at":"2024-12-18T09:34:59Z","title":"GLCF: A Global-Local Multimodal Coherence Analysis Framework for Talking Face Generation Detection","version":2},"reference_index":11,"source":"arxiv_source","source_observed_at":"2026-08-11T12:58:32.763865Z"},"links":{"citing_paper":"/paper/2412.13656"},"observation_digest":"sha256:5a9687382ecb38f1d9598ed5c68d3f075614bf044e07162a71ad077d3df5ca26","observation_id":"224b6877-53b0-436b-9c23-88c0d7e18695","resolution":{"observed_at":"2026-08-11T12:58:34.160836Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1710.10196","last_updated":"2018-02-26T15:33:34Z","snapshot_observed_at":"2026-08-18T02:27:14.215000Z","submitted_at":"2017-10-27T15:28:35Z","title":"Progressive Growing of GANs for Improved Quality, Stability, and Variation","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1710.10196","snapshot_observed_at":"2026-08-11T12:58:32.766621Z","title":null,"venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2412.13656","last_updated":"2025-02-24T06:29:16Z","snapshot_observed_at":"2026-08-18T03:36:38.145712Z","submitted_at":"2024-12-18T09:34:59Z","title":"GLCF: A Global-Local Multimodal Coherence Analysis Framework for Talking Face Generation Detection","version":2},"reference_index":12,"source":"arxiv_source","source_observed_at":"2026-08-11T12:58:32.766621Z"},"links":{"cited_paper":"/paper/1710.10196","citing_paper":"/paper/2412.13656"},"observation_digest":"sha256:fb3f56ec63f7cba7226f2da0c06cec8bd58b1edd3d5e21b882e19c1f19d02627","observation_id":"41923f72-fb0a-4100-a089-d81da050b851","resolution":{"observed_at":"2026-08-11T12:58:32.766621Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2108.05080","last_updated":"2022-03-01T10:38:07Z","snapshot_observed_at":"2026-08-18T16:37:53.032175Z","submitted_at":"2021-08-11T07:49:36Z","title":"FakeAVCeleb: A Novel Audio-Video Multimodal Deepfake Dataset","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2108.05080","snapshot_observed_at":"2026-08-11T12:58:32.770164Z","title":null,"venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2412.13656","last_updated":"2025-02-24T06:29:16Z","snapshot_observed_at":"2026-08-18T03:36:38.145712Z","submitted_at":"2024-12-18T09:34:59Z","title":"GLCF: A Global-Local Multimodal Coherence Analysis Framework for Talking Face Generation Detection","version":2},"reference_index":13,"source":"arxiv_source","source_observed_at":"2026-08-11T12:58:32.770164Z"},"links":{"cited_paper":"/paper/2108.05080","citing_paper":"/paper/2412.13656"},"observation_digest":"sha256:5a8e0b24a7c253e2169342e355d1bbce0a37e5419cb2120b0eccfad070a54636","observation_id":"a111d174-b0d6-431c-a02d-88d010547b9b","resolution":{"observed_at":"2026-08-11T12:58:32.770164Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T12:58:34.046226Z","title":null,"venue":null,"work_id":"7bfd9429-b2a1-4791-bc05-1ed7a7418a82","year":2018},"citing_paper":{"arxiv_id":"2412.13656","last_updated":"2025-02-24T06:29:16Z","snapshot_observed_at":"2026-08-18T03:36:38.145712Z","submitted_at":"2024-12-18T09:34:59Z","title":"GLCF: A Global-Local Multimodal Coherence Analysis Framework for Talking Face Generation Detection","version":2},"reference_index":14,"source":"arxiv_source","source_observed_at":"2026-08-11T12:58:32.774066Z"},"links":{"citing_paper":"/paper/2412.13656"},"observation_digest":"sha256:e94c45c679a97e0b1a2f6445519de21f721b4670099b747b8cd1f4e3793e2b07","observation_id":"a0b42f66-80c9-44c7-9705-dae50229b6ba","resolution":{"observed_at":"2026-08-11T12:58:34.048426Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T12:58:34.034741Z","title":null,"venue":null,"work_id":"939e6708-40b3-4224-a887-31f4dc4629ee","year":2021},"citing_paper":{"arxiv_id":"2412.13656","last_updated":"2025-02-24T06:29:16Z","snapshot_observed_at":"2026-08-18T03:36:38.145712Z","submitted_at":"2024-12-18T09:34:59Z","title":"GLCF: A Global-Local Multimodal Coherence Analysis Framework for Talking Face Generation Detection","version":2},"reference_index":15,"source":"arxiv_source","source_observed_at":"2026-08-11T12:58:32.796775Z"},"links":{"citing_paper":"/paper/2412.13656"},"observation_digest":"sha256:d891efa0594ca73d88bdfcc127041ac29e0d889fa170468c805bbba571010591","observation_id":"f2fd041e-0afd-4691-ad2d-ac3bd4fa81a5","resolution":{"observed_at":"2026-08-11T12:58:34.039618Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2207.12308","last_updated":"2023-07-18T04:21:40Z","snapshot_observed_at":"2026-08-16T16:46:36.651415Z","submitted_at":"2022-07-12T13:27:21Z","title":"CFAD: A Chinese Dataset for Fake Audio Detection","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2207.12308","snapshot_observed_at":"2026-08-11T12:58:32.842376Z","title":null,"venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2412.13656","last_updated":"2025-02-24T06:29:16Z","snapshot_observed_at":"2026-08-18T03:36:38.145712Z","submitted_at":"2024-12-18T09:34:59Z","title":"GLCF: A Global-Local Multimodal Coherence Analysis Framework for Talking Face Generation Detection","version":2},"reference_index":16,"source":"arxiv_source","source_observed_at":"2026-08-11T12:58:32.842376Z"},"links":{"cited_paper":"/paper/2207.12308","citing_paper":"/paper/2412.13656"},"observation_digest":"sha256:1895f3e1e5024becf5e754373770c3104ebc4b4d8e96efac10c8c4ea722dc238","observation_id":"929eeb1c-7a50-4176-8305-82953fbc50fd","resolution":{"observed_at":"2026-08-11T12:58:32.842376Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T12:58:33.921523Z","title":null,"venue":null,"work_id":"87a6a1fb-264a-4dc9-9ee5-10db5b5aece4","year":2021},"citing_paper":{"arxiv_id":"2412.13656","last_updated":"2025-02-24T06:29:16Z","snapshot_observed_at":"2026-08-18T03:36:38.145712Z","submitted_at":"2024-12-18T09:34:59Z","title":"GLCF: A Global-Local Multimodal Coherence Analysis Framework for Talking Face Generation Detection","version":2},"reference_index":17,"source":"arxiv_source","source_observed_at":"2026-08-11T12:58:32.949343Z"},"links":{"citing_paper":"/paper/2412.13656"},"observation_digest":"sha256:9b8e97599e229a1661592437996e13e2a24418dec48986adb5666a7fbefdb388","observation_id":"1f820b36-df29-4673-a818-99cb04079e44","resolution":{"observed_at":"2026-08-11T12:58:34.021234Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T12:58:33.912566Z","title":"T.; and Shrivastava, A","venue":null,"work_id":"023c74aa-d478-4f40-86c5-1f3877c5b1b0","year":2024},"citing_paper":{"arxiv_id":"2412.13656","last_updated":"2025-02-24T06:29:16Z","snapshot_observed_at":"2026-08-18T03:36:38.145712Z","submitted_at":"2024-12-18T09:34:59Z","title":"GLCF: A Global-Local Multimodal Coherence Analysis Framework for Talking Face Generation Detection","version":2},"reference_index":18,"source":"arxiv_source","source_observed_at":"2026-08-11T12:58:33.058067Z"},"links":{"citing_paper":"/paper/2412.13656"},"observation_digest":"sha256:019094b0c25e7d7d3566971cfb768c79c9bc8a8e619121b8ca3b78265491de18","observation_id":"b2e67851-a65b-4832-974b-9b1dedcd71e6","resolution":{"observed_at":"2026-08-11T12:58:33.916369Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1706.08612","last_updated":"2018-05-30T06:52:06Z","snapshot_observed_at":"2026-08-18T23:33:12.915054Z","submitted_at":"2017-06-26T21:42:27Z","title":"VoxCeleb: a large-scale speaker identification dataset","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1706.08612","snapshot_observed_at":"2026-08-11T12:58:33.087393Z","title":"S.; and Zisserman, A","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2412.13656","last_updated":"2025-02-24T06:29:16Z","snapshot_observed_at":"2026-08-18T03:36:38.145712Z","submitted_at":"2024-12-18T09:34:59Z","title":"GLCF: A Global-Local Multimodal Coherence Analysis Framework for Talking Face Generation Detection","version":2},"reference_index":19,"source":"arxiv_source","source_observed_at":"2026-08-11T12:58:33.087393Z"},"links":{"cited_paper":"/paper/1706.08612","citing_paper":"/paper/2412.13656"},"observation_digest":"sha256:18848eb4ae448011d04fa63e73a78aa4af2481dd9c1edca2ec7008351fd36236","observation_id":"c71870c2-b0b4-49e2-bdd4-012cd5663604","resolution":{"observed_at":"2026-08-11T12:58:33.087393Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T12:58:33.822543Z","title":null,"venue":null,"work_id":"2a22e6fc-6933-483c-9202-6718fc18dea1","year":2023},"citing_paper":{"arxiv_id":"2412.13656","last_updated":"2025-02-24T06:29:16Z","snapshot_observed_at":"2026-08-18T03:36:38.145712Z","submitted_at":"2024-12-18T09:34:59Z","title":"GLCF: A Global-Local Multimodal Coherence Analysis Framework for Talking Face Generation Detection","version":2},"reference_index":20,"source":"arxiv_source","source_observed_at":"2026-08-11T12:58:33.092166Z"},"links":{"citing_paper":"/paper/2412.13656"},"observation_digest":"sha256:ea58a4b4826a41c3734676fae5cd978cc9b401874ed424a5d9dfb23fa15f4107","observation_id":"ac1404db-fb00-4d6d-b57f-c1532438430a","resolution":{"observed_at":"2026-08-11T12:58:33.905285Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T12:58:33.702977Z","title":null,"venue":null,"work_id":"e699f547-80a2-4b1a-9b25-4cab0f1adf99","year":2015},"citing_paper":{"arxiv_id":"2412.13656","last_updated":"2025-02-24T06:29:16Z","snapshot_observed_at":"2026-08-18T03:36:38.145712Z","submitted_at":"2024-12-18T09:34:59Z","title":"GLCF: A Global-Local Multimodal Coherence Analysis Framework for Talking Face Generation Detection","version":2},"reference_index":21,"source":"arxiv_source","source_observed_at":"2026-08-11T12:58:33.095673Z"},"links":{"citing_paper":"/paper/2412.13656"},"observation_digest":"sha256:e354638f3a24a827c9bdbcc3f52264240bd0e8f3cf38332ec2ed31686582c03f","observation_id":"b299413d-d507-4d0b-80ea-b8b6ce45fe84","resolution":{"observed_at":"2026-08-11T12:58:33.746872Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T12:58:33.649797Z","title":null,"venue":null,"work_id":"c45c9c97-efee-48ac-a221-9559f8b789da","year":2024},"citing_paper":{"arxiv_id":"2412.13656","last_updated":"2025-02-24T06:29:16Z","snapshot_observed_at":"2026-08-18T03:36:38.145712Z","submitted_at":"2024-12-18T09:34:59Z","title":"GLCF: A Global-Local Multimodal Coherence Analysis Framework for Talking Face Generation Detection","version":2},"reference_index":22,"source":"arxiv_source","source_observed_at":"2026-08-11T12:58:33.098394Z"},"links":{"citing_paper":"/paper/2412.13656"},"observation_digest":"sha256:32a26e41ef6c6974d608c64b8c55dcbf51f9d6f4a1dc92d7a2e62bf88fc76f9a","observation_id":"5ec34e97-3ccb-42af-9e2a-0839bc36e80d","resolution":{"observed_at":"2026-08-11T12:58:33.652381Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T12:58:33.640590Z","title":null,"venue":null,"work_id":"003168d2-6603-47dc-b72f-02b15a207210","year":2024},"citing_paper":{"arxiv_id":"2412.13656","last_updated":"2025-02-24T06:29:16Z","snapshot_observed_at":"2026-08-18T03:36:38.145712Z","submitted_at":"2024-12-18T09:34:59Z","title":"GLCF: A Global-Local Multimodal Coherence Analysis Framework for Talking Face Generation Detection","version":2},"reference_index":23,"source":"arxiv_source","source_observed_at":"2026-08-11T12:58:33.101826Z"},"links":{"citing_paper":"/paper/2412.13656"},"observation_digest":"sha256:13076d73ca5cee0294f140da623cc76eb4a24ff0a9f860e27ea417b8bb1bc7ab","observation_id":"df2943c6-42a4-4dc8-b103-b78a2b3e5c73","resolution":{"observed_at":"2026-08-11T12:58:33.643240Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T12:58:33.632315Z","title":null,"venue":null,"work_id":"8e682244-08d1-40c0-bea0-fe89a776af72","year":2020},"citing_paper":{"arxiv_id":"2412.13656","last_updated":"2025-02-24T06:29:16Z","snapshot_observed_at":"2026-08-18T03:36:38.145712Z","submitted_at":"2024-12-18T09:34:59Z","title":"GLCF: A Global-Local Multimodal Coherence Analysis Framework for Talking Face Generation Detection","version":2},"reference_index":24,"source":"arxiv_source","source_observed_at":"2026-08-11T12:58:33.105237Z"},"links":{"citing_paper":"/paper/2412.13656"},"observation_digest":"sha256:cf5ff2c0e61ee288bf68f0cb9976d3ca5174ca7beda5643e7c91a72b0efc9d4a","observation_id":"b533f3af-5569-453f-9d94-222f2fe5ea96","resolution":{"observed_at":"2026-08-11T12:58:33.635300Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T12:58:33.623036Z","title":null,"venue":null,"work_id":"2879844e-5eb1-41b7-a78d-2b3e57d227f4","year":2019},"citing_paper":{"arxiv_id":"2412.13656","last_updated":"2025-02-24T06:29:16Z","snapshot_observed_at":"2026-08-18T03:36:38.145712Z","submitted_at":"2024-12-18T09:34:59Z","title":"GLCF: A Global-Local Multimodal Coherence Analysis Framework for Talking Face Generation Detection","version":2},"reference_index":25,"source":"arxiv_source","source_observed_at":"2026-08-11T12:58:33.107789Z"},"links":{"citing_paper":"/paper/2412.13656"},"observation_digest":"sha256:5f7cc097b64f1fb2198fc2110ef1625f9c243bf6826c2e231d1c8d31bb732699","observation_id":"0221a3eb-a05e-4a99-9500-b57d43290051","resolution":{"observed_at":"2026-08-11T12:58:33.625935Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T12:58:33.109754Z","title":"R.; Cogswell, M.; Das, A.; Vedantam, R.; Parikh, D.; and Batra, D","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2412.13656","last_updated":"2025-02-24T06:29:16Z","snapshot_observed_at":"2026-08-18T03:36:38.145712Z","submitted_at":"2024-12-18T09:34:59Z","title":"GLCF: A Global-Local Multimodal Coherence Analysis Framework for Talking Face Generation Detection","version":2},"reference_index":26,"source":"arxiv_source","source_observed_at":"2026-08-11T12:58:33.109754Z"},"links":{"citing_paper":"/paper/2412.13656"},"observation_digest":"sha256:beab1c63b7ae42edb83318a5dc77f551c63cbebb0ade0d43933bbbefea98b1f0","observation_id":"7a5647f4-aeb6-48c5-af77-b3e9b20e4efb","resolution":{"observed_at":"2026-08-11T12:58:33.109754Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T12:58:33.609843Z","title":null,"venue":null,"work_id":"0085eb3e-d272-42ca-abf5-296841e77683","year":2017},"citing_paper":{"arxiv_id":"2412.13656","last_updated":"2025-02-24T06:29:16Z","snapshot_observed_at":"2026-08-18T03:36:38.145712Z","submitted_at":"2024-12-18T09:34:59Z","title":"GLCF: A Global-Local Multimodal Coherence Analysis Framework for Talking Face Generation Detection","version":2},"reference_index":27,"source":"arxiv_source","source_observed_at":"2026-08-11T12:58:33.112658Z"},"links":{"citing_paper":"/paper/2412.13656"},"observation_digest":"sha256:93f5dd6fc960014d4099f99334a013148166344cfe4a6b1289edf9e35ba7ed99","observation_id":"428bf39a-9ec4-4056-8956-d68cde785870","resolution":{"observed_at":"2026-08-11T12:58:33.612721Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T12:58:33.600536Z","title":null,"venue":null,"work_id":"4c2634ad-b1b2-421e-a407-b602c11030d5","year":2023},"citing_paper":{"arxiv_id":"2412.13656","last_updated":"2025-02-24T06:29:16Z","snapshot_observed_at":"2026-08-18T03:36:38.145712Z","submitted_at":"2024-12-18T09:34:59Z","title":"GLCF: A Global-Local Multimodal Coherence Analysis Framework for Talking Face Generation Detection","version":2},"reference_index":28,"source":"arxiv_source","source_observed_at":"2026-08-11T12:58:33.115653Z"},"links":{"citing_paper":"/paper/2412.13656"},"observation_digest":"sha256:1eef9e4ed154bdd7667ef9bbfe2a40b66c31e869c8a326237ffbc1f2bc5b7d87","observation_id":"d83c75ca-9b7a-44ee-9499-b6037ad4b83b","resolution":{"observed_at":"2026-08-11T12:58:33.604187Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2403.07240","last_updated":"2024-03-12T01:28:00Z","snapshot_observed_at":"2026-08-16T14:10:45.786855Z","submitted_at":"2024-03-12T01:28:00Z","title":"Frequency-Aware Deepfake Detection: Improving Generalizability through Frequency Space Learning","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2403.07240","snapshot_observed_at":"2026-08-11T12:58:33.118855Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2412.13656","last_updated":"2025-02-24T06:29:16Z","snapshot_observed_at":"2026-08-18T03:36:38.145712Z","submitted_at":"2024-12-18T09:34:59Z","title":"GLCF: A Global-Local Multimodal Coherence Analysis Framework for Talking Face Generation Detection","version":2},"reference_index":29,"source":"arxiv_source","source_observed_at":"2026-08-11T12:58:33.118855Z"},"links":{"cited_paper":"/paper/2403.07240","citing_paper":"/paper/2412.13656"},"observation_digest":"sha256:656d603304191f7688878221e9278754af212dfdaa628f3f67c417d6d5a3f6d4","observation_id":"f96ceec8-2e51-4178-a052-ba7c3e2315a1","resolution":{"observed_at":"2026-08-11T12:58:33.118855Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1904.05441","last_updated":"2019-04-14T11:38:32Z","snapshot_observed_at":"2026-08-15T22:10:10.299222Z","submitted_at":"2019-04-09T15:12:52Z","title":"ASVspoof 2019: Future Horizons in Spoofed and Fake Audio Detection","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1904.05441","snapshot_observed_at":"2026-08-11T12:58:33.122219Z","title":null,"venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2412.13656","last_updated":"2025-02-24T06:29:16Z","snapshot_observed_at":"2026-08-18T03:36:38.145712Z","submitted_at":"2024-12-18T09:34:59Z","title":"GLCF: A Global-Local Multimodal Coherence Analysis Framework for Talking Face Generation Detection","version":2},"reference_index":30,"source":"arxiv_source","source_observed_at":"2026-08-11T12:58:33.122219Z"},"links":{"cited_paper":"/paper/1904.05441","citing_paper":"/paper/2412.13656"},"observation_digest":"sha256:5667e5628f01781c4448813db3546c4661c5d7d4e23f134eb320e9c700f8f483","observation_id":"e0ea3271-3958-44b9-960f-17e7bd278645","resolution":{"observed_at":"2026-08-11T12:58:33.122219Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T12:58:33.517427Z","title":null,"venue":null,"work_id":"d7529099-5571-467f-900e-5eb40d3b49f1","year":2021},"citing_paper":{"arxiv_id":"2412.13656","last_updated":"2025-02-24T06:29:16Z","snapshot_observed_at":"2026-08-18T03:36:38.145712Z","submitted_at":"2024-12-18T09:34:59Z","title":"GLCF: A Global-Local Multimodal Coherence Analysis Framework for Talking Face Generation Detection","version":2},"reference_index":31,"source":"arxiv_source","source_observed_at":"2026-08-11T12:58:33.124874Z"},"links":{"citing_paper":"/paper/2412.13656"},"observation_digest":"sha256:ec675819efcdd58a084462a95deab08f07212137b813f2b3614e908fd02a051c","observation_id":"b7ba39f8-eabe-436d-8ed6-b0c4048f39ce","resolution":{"observed_at":"2026-08-11T12:58:33.594301Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T12:58:33.403702Z","title":null,"venue":null,"work_id":"27ff1413-f372-4741-96f2-2539789f90c1","year":2020},"citing_paper":{"arxiv_id":"2412.13656","last_updated":"2025-02-24T06:29:16Z","snapshot_observed_at":"2026-08-18T03:36:38.145712Z","submitted_at":"2024-12-18T09:34:59Z","title":"GLCF: A Global-Local Multimodal Coherence Analysis Framework for Talking Face Generation Detection","version":2},"reference_index":32,"source":"arxiv_source","source_observed_at":"2026-08-11T12:58:33.127852Z"},"links":{"citing_paper":"/paper/2412.13656"},"observation_digest":"sha256:9bd9611074472d501ba03f038199b8b93ba84ac2228002e0aa8a5c4992cba44f","observation_id":"6b42ce81-f0cd-45b2-a359-1c1e4f2b92a2","resolution":{"observed_at":"2026-08-11T12:58:33.462051Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2403.14974","last_updated":"2024-03-22T06:04:37Z","snapshot_observed_at":"2026-08-16T14:07:27.167214Z","submitted_at":"2024-03-22T06:04:37Z","title":"AVT2-DWF: Improving Deepfake Detection with Audio-Visual Fusion and Dynamic Weighting Strategies","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2403.14974","snapshot_observed_at":"2026-08-11T12:58:33.130508Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2412.13656","last_updated":"2025-02-24T06:29:16Z","snapshot_observed_at":"2026-08-18T03:36:38.145712Z","submitted_at":"2024-12-18T09:34:59Z","title":"GLCF: A Global-Local Multimodal Coherence Analysis Framework for Talking Face Generation Detection","version":2},"reference_index":33,"source":"arxiv_source","source_observed_at":"2026-08-11T12:58:33.130508Z"},"links":{"cited_paper":"/paper/2403.14974","citing_paper":"/paper/2412.13656"},"observation_digest":"sha256:2c4e89e4c246676c66fa9ca665a9ca3b10a36342a7bc82a4e04b20d1bb111896","observation_id":"9c3c2a89-f029-45f4-a2c7-b637d50fe8c4","resolution":{"observed_at":"2026-08-11T12:58:33.130508Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T12:58:33.379219Z","title":null,"venue":null,"work_id":"7734f1c2-2d65-428c-982d-b0c1955dd65d","year":2023},"citing_paper":{"arxiv_id":"2412.13656","last_updated":"2025-02-24T06:29:16Z","snapshot_observed_at":"2026-08-18T03:36:38.145712Z","submitted_at":"2024-12-18T09:34:59Z","title":"GLCF: A Global-Local Multimodal Coherence Analysis Framework for Talking Face Generation Detection","version":2},"reference_index":34,"source":"arxiv_source","source_observed_at":"2026-08-11T12:58:33.133652Z"},"links":{"citing_paper":"/paper/2412.13656"},"observation_digest":"sha256:93ad85988d2070b43f1c63493d218ddba03a07c58943a1bee2cb11d8d4525cba","observation_id":"f72daac4-d45c-4df0-b1b8-cf27a7fb32e9","resolution":{"observed_at":"2026-08-11T12:58:33.381786Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T12:58:33.372522Z","title":null,"venue":null,"work_id":"bbe76525-60bb-4652-be92-e72f2cbb87dc","year":2024},"citing_paper":{"arxiv_id":"2412.13656","last_updated":"2025-02-24T06:29:16Z","snapshot_observed_at":"2026-08-18T03:36:38.145712Z","submitted_at":"2024-12-18T09:34:59Z","title":"GLCF: A Global-Local Multimodal Coherence Analysis Framework for Talking Face Generation Detection","version":2},"reference_index":35,"source":"arxiv_source","source_observed_at":"2026-08-11T12:58:33.136370Z"},"links":{"citing_paper":"/paper/2412.13656"},"observation_digest":"sha256:6c938842f9df4a5897cf97883edd2349cb3904e21f214c4f476dd268dc8c4b3b","observation_id":"f40e84e7-500e-47f4-bfd9-6762f66614df","resolution":{"observed_at":"2026-08-11T12:58:33.375035Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T12:58:33.364262Z","title":null,"venue":null,"work_id":"4732962e-afbb-449e-883c-c80f49d46129","year":2023},"citing_paper":{"arxiv_id":"2412.13656","last_updated":"2025-02-24T06:29:16Z","snapshot_observed_at":"2026-08-18T03:36:38.145712Z","submitted_at":"2024-12-18T09:34:59Z","title":"GLCF: A Global-Local Multimodal Coherence Analysis Framework for Talking Face Generation Detection","version":2},"reference_index":36,"source":"arxiv_source","source_observed_at":"2026-08-11T12:58:33.139244Z"},"links":{"citing_paper":"/paper/2412.13656"},"observation_digest":"sha256:240d37dd96a34e0f58dcbca7ac11e8b82dc376a0c35a91dcc2239719e1170695","observation_id":"409b76a2-89c6-4f17-8256-9ce4a43ab176","resolution":{"observed_at":"2026-08-11T12:58:33.366969Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T12:58:33.141446Z","title":null,"venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2412.13656","last_updated":"2025-02-24T06:29:16Z","snapshot_observed_at":"2026-08-18T03:36:38.145712Z","submitted_at":"2024-12-18T09:34:59Z","title":"GLCF: A Global-Local Multimodal Coherence Analysis Framework for Talking Face Generation Detection","version":2},"reference_index":37,"source":"arxiv_source","source_observed_at":"2026-08-11T12:58:33.141446Z"},"links":{"citing_paper":"/paper/2412.13656"},"observation_digest":"sha256:c884036b462b8d68cb570843b3b761599241194c5534a53cfc6001594a90019f","observation_id":"98b8875c-5ef4-45e7-9770-9d9f7ec523b1","resolution":{"observed_at":"2026-08-11T12:58:33.141446Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T12:58:33.352025Z","title":null,"venue":null,"work_id":"39cc8e4c-7102-4057-98de-bf85d8ff80ad","year":2023},"citing_paper":{"arxiv_id":"2412.13656","last_updated":"2025-02-24T06:29:16Z","snapshot_observed_at":"2026-08-18T03:36:38.145712Z","submitted_at":"2024-12-18T09:34:59Z","title":"GLCF: A Global-Local Multimodal Coherence Analysis Framework for Talking Face Generation Detection","version":2},"reference_index":38,"source":"arxiv_source","source_observed_at":"2026-08-11T12:58:33.144345Z"},"links":{"citing_paper":"/paper/2412.13656"},"observation_digest":"sha256:c4b87af0d2b757e425c6d211e13a69cbd206ff92efef12fa9a6a98249042e6b3","observation_id":"6d459e54-d84d-4ebe-894e-9d513b7935af","resolution":{"observed_at":"2026-08-11T12:58:33.354699Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T12:58:33.343050Z","title":null,"venue":null,"work_id":"8de56d13-91f8-49db-848c-e2269ac64ea9","year":2021},"citing_paper":{"arxiv_id":"2412.13656","last_updated":"2025-02-24T06:29:16Z","snapshot_observed_at":"2026-08-18T03:36:38.145712Z","submitted_at":"2024-12-18T09:34:59Z","title":"GLCF: A Global-Local Multimodal Coherence Analysis Framework for Talking Face Generation Detection","version":2},"reference_index":39,"source":"arxiv_source","source_observed_at":"2026-08-11T12:58:33.147162Z"},"links":{"citing_paper":"/paper/2412.13656"},"observation_digest":"sha256:48e4de3ce633721196addba1b4ef1b9dfef88e2495bf23df5d6ed2d6e6f4e58e","observation_id":"c63e7335-4ad9-4cf9-9e4e-697d66bb7261","resolution":{"observed_at":"2026-08-11T12:58:33.345864Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T12:58:33.335219Z","title":null,"venue":null,"work_id":"482cd6b8-f2e8-4de3-9262-9faf6e861a91","year":2021},"citing_paper":{"arxiv_id":"2412.13656","last_updated":"2025-02-24T06:29:16Z","snapshot_observed_at":"2026-08-18T03:36:38.145712Z","submitted_at":"2024-12-18T09:34:59Z","title":"GLCF: A Global-Local Multimodal Coherence Analysis Framework for Talking Face Generation Detection","version":2},"reference_index":40,"source":"arxiv_source","source_observed_at":"2026-08-11T12:58:33.149714Z"},"links":{"citing_paper":"/paper/2412.13656"},"observation_digest":"sha256:73335a660f4753deb305ebe83827a789b4b352e75adca54fb2fefe3b449ca97e","observation_id":"50af1a8a-7c72-4b85-bb84-bdcd1b9545a1","resolution":{"observed_at":"2026-08-11T12:58:33.337364Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T12:58:33.152805Z","title":", \" * write output.state after.block = add.period write newline","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2412.13656","last_updated":"2025-02-24T06:29:16Z","snapshot_observed_at":"2026-08-18T03:36:38.145712Z","submitted_at":"2024-12-18T09:34:59Z","title":"GLCF: A Global-Local Multimodal Coherence Analysis Framework for Talking Face Generation Detection","version":2},"reference_index":41,"source":"arxiv_source","source_observed_at":"2026-08-11T12:58:33.152805Z"},"links":{"citing_paper":"/paper/2412.13656"},"observation_digest":"sha256:fba1d00f23164693a8a623921b97496f336171f3c5b7663c5793b986c410d924","observation_id":"c85ca2d0-33e9-409c-9df8-0e8a821d3ba8","resolution":{"observed_at":"2026-08-11T12:58:33.152805Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T12:58:33.169463Z","title":"write newline","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2412.13656","last_updated":"2025-02-24T06:29:16Z","snapshot_observed_at":"2026-08-18T03:36:38.145712Z","submitted_at":"2024-12-18T09:34:59Z","title":"GLCF: A Global-Local Multimodal Coherence Analysis Framework for Talking Face Generation Detection","version":2},"reference_index":42,"source":"arxiv_source","source_observed_at":"2026-08-11T12:58:33.169463Z"},"links":{"citing_paper":"/paper/2412.13656"},"observation_digest":"sha256:e234546e07dbbb9066cf52b283041d3190373027a629cd16a89a425a811940b9","observation_id":"b1bc5ba6-f787-4db2-94fb-6be809e8f40b","resolution":{"observed_at":"2026-08-11T12:58:33.169463Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"paper":{"arxiv_id":"2412.13656","last_updated":"2025-02-24T06:29:16Z","latest_version":2,"primary_category":"cs.CV","snapshot_observed_at":"2026-08-18T03:36:38.145712Z","submitted_at":"2024-12-18T09:34:59Z","title":"GLCF: A Global-Local Multimodal Coherence Analysis Framework for Talking Face Generation Detection"},"reference_resolution":{"displayed":42,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":39,"verified_exact":1,"verified_fuzzy":2},"total_outbound_references":42},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"thesis":"As of 19 August 2026, this Paper Citation Record lists 42 of 42 outbound references and 0 inbound Pith citation observations for arXiv:2412.13656."}