{"as_of":"2026-08-19T01:39:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:e2b5932afa5b44808b7e962a083578362f57724fcb5734a7dc04c6d48918f07a","coverage":[{"denominator":53,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":53,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-07T10:18:40.860197Z","state":"measured"},{"denominator":53,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":53,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-18T06:34:40.430872+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2506.05851/citation-record","integrity":"/paper/2506.05851/integrity","json":"/paper/2506.05851/citation-record.json","paper":"/paper/2506.05851"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T10:18:34.040956Z","title":"Senior, Oriol Vinyals, and Andrew Zisser- man","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2506.05851","last_updated":"2025-06-06T08:10:54Z","snapshot_observed_at":"2026-08-17T18:47:06.521919Z","submitted_at":"2025-06-06T08:10:54Z","title":"DeepFake Doctor: Diagnosing and Treating Audio-Video Fake Detection","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-07T10:18:34.040956Z"},"links":{"citing_paper":"/paper/2506.05851"},"observation_digest":"sha256:823503d34219b3ef7f1e188e37338983b7a08c35a72f022505e6180d7da5f91e","observation_id":"137a5580-54bc-46c3-a17b-01fa312a7735","resolution":{"observed_at":"2026-08-07T10:18:34.040956Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T10:18:49.982706Z","title":"Detecting deep-fake videos from phoneme-viseme mismatches","venue":null,"work_id":"2077c925-c949-47b9-b637-ba4ce1df58bc","year":2020},"citing_paper":{"arxiv_id":"2506.05851","last_updated":"2025-06-06T08:10:54Z","snapshot_observed_at":"2026-08-17T18:47:06.521919Z","submitted_at":"2025-06-06T08:10:54Z","title":"DeepFake Doctor: Diagnosing and Treating Audio-Video Fake Detection","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-07T10:18:34.144548Z"},"links":{"citing_paper":"/paper/2506.05851"},"observation_digest":"sha256:65cc34a8e8f94a364cba7bb480ac9ee588e5193a5ff9287de1d2cc65d79d4a53","observation_id":"391d8aed-ff5c-4f69-9c05-6ad947eb7f4b","resolution":{"observed_at":"2026-08-07T10:18:50.077697Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2408.05366","last_updated":"2026-04-06T23:43:02Z","snapshot_observed_at":"2026-08-14T10:23:20.676290Z","submitted_at":"2024-08-09T22:29:43Z","title":"The DeepSpeak Dataset","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2408.05366","snapshot_observed_at":"2026-08-07T10:18:34.419801Z","title":"Deepspeak dataset v1.0.CoRR, abs/2408.05366, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.05851","last_updated":"2025-06-06T08:10:54Z","snapshot_observed_at":"2026-08-17T18:47:06.521919Z","submitted_at":"2025-06-06T08:10:54Z","title":"DeepFake Doctor: Diagnosing and Treating Audio-Video Fake Detection","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-07T10:18:34.419801Z"},"links":{"cited_paper":"/paper/2408.05366","citing_paper":"/paper/2506.05851"},"observation_digest":"sha256:5fa0880965aab796356e7606a581529a66008365cf21785429e6f7d520b4521d","observation_id":"c5ab2175-98ce-4bf8-9ea2-f91fcf616805","resolution":{"observed_at":"2026-08-07T10:18:34.419801Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T10:18:49.740956Z","title":"Lost in translation: Lip-sync deepfake detection from audio- video mismatch","venue":null,"work_id":"65a2a583-7db1-44a6-a838-934c019b2aa0","year":2024},"citing_paper":{"arxiv_id":"2506.05851","last_updated":"2025-06-06T08:10:54Z","snapshot_observed_at":"2026-08-17T18:47:06.521919Z","submitted_at":"2025-06-06T08:10:54Z","title":"DeepFake Doctor: Diagnosing and Treating Audio-Video Fake Detection","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-07T10:18:34.518048Z"},"links":{"citing_paper":"/paper/2506.05851"},"observation_digest":"sha256:9df7eea25eec2f9765c184e92d1832a5dba8eeaa859b6a0ce0465e186528d56c","observation_id":"71e7f34b-180b-4746-9d74-fb0bd3a3b8a2","resolution":{"observed_at":"2026-08-07T10:18:49.846823Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T10:18:49.436415Z","title":"Circumventing shortcuts in audio-visual deepfake detection datasets with unsupervised learning.To appear in CVPR, 2025","venue":null,"work_id":"8f6a531c-6891-4129-ba5b-50ff5aaef88a","year":2025},"citing_paper":{"arxiv_id":"2506.05851","last_updated":"2025-06-06T08:10:54Z","snapshot_observed_at":"2026-08-17T18:47:06.521919Z","submitted_at":"2025-06-06T08:10:54Z","title":"DeepFake Doctor: Diagnosing and Treating Audio-Video Fake Detection","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-07T10:18:34.627772Z"},"links":{"citing_paper":"/paper/2506.05851"},"observation_digest":"sha256:dd4b0cb5e3b411f2a7ef93601b3a8c7ab43071dfbd235cfd0e9bd8cd9aff6543","observation_id":"11a88e2c-7f21-4cc4-b4a7-e90c760db9d6","resolution":{"observed_at":"2026-08-07T10:18:49.569037Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T10:18:49.078150Z","title":"Do you really mean that? content driven audio-visual deepfake dataset and multimodal method for temporal forgery localization","venue":null,"work_id":"c15b4a91-adf0-4481-892b-1e5ed5ee2e5e","year":null},"citing_paper":{"arxiv_id":"2506.05851","last_updated":"2025-06-06T08:10:54Z","snapshot_observed_at":"2026-08-17T18:47:06.521919Z","submitted_at":"2025-06-06T08:10:54Z","title":"DeepFake Doctor: Diagnosing and Treating Audio-Video Fake Detection","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-07T10:18:34.744641Z"},"links":{"citing_paper":"/paper/2506.05851"},"observation_digest":"sha256:232c8957be26efb9b959351a07ab1fbeaa82d49b20d8ba070ebc3c82fcfd243a","observation_id":"fb4dd59d-341d-4699-acff-e1bb683953ad","resolution":{"observed_at":"2026-08-07T10:18:49.251817Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T10:18:34.900423Z","title":"Av-deepfake1m: A large-scale llm-driven audio-visual deepfake dataset","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.05851","last_updated":"2025-06-06T08:10:54Z","snapshot_observed_at":"2026-08-17T18:47:06.521919Z","submitted_at":"2025-06-06T08:10:54Z","title":"DeepFake Doctor: Diagnosing and Treating Audio-Video Fake Detection","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-07T10:18:34.900423Z"},"links":{"citing_paper":"/paper/2506.05851"},"observation_digest":"sha256:7d777fe49e685bac0edc59db120426eabf1dbe3c0e069fca83c868c53814f0e6","observation_id":"89acdd4a-85c0-4e88-8425-db31d6137f7d","resolution":{"observed_at":"2026-08-07T10:18:34.900423Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T10:18:35.020180Z","title":"Trusted media challenge dataset and user study","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2506.05851","last_updated":"2025-06-06T08:10:54Z","snapshot_observed_at":"2026-08-17T18:47:06.521919Z","submitted_at":"2025-06-06T08:10:54Z","title":"DeepFake Doctor: Diagnosing and Treating Audio-Video Fake Detection","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-07T10:18:35.020180Z"},"links":{"citing_paper":"/paper/2506.05851"},"observation_digest":"sha256:219a1fe261e9133c7085d11f814c6ffe7850e0f08c39bdfaf1712e2ba76e2ba5","observation_id":"b438945d-eb13-4c3f-8af5-080004ef07f9","resolution":{"observed_at":"2026-08-07T10:18:35.020180Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T10:18:48.822880Z","title":"V oice-face homogeneity tells deepfake.ACM Trans","venue":null,"work_id":"060bd670-03f8-47c0-8ac5-1d34e872d7db","year":null},"citing_paper":{"arxiv_id":"2506.05851","last_updated":"2025-06-06T08:10:54Z","snapshot_observed_at":"2026-08-17T18:47:06.521919Z","submitted_at":"2025-06-06T08:10:54Z","title":"DeepFake Doctor: Diagnosing and Treating Audio-Video Fake Detection","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-07T10:18:35.133827Z"},"links":{"citing_paper":"/paper/2506.05851"},"observation_digest":"sha256:e8b71939455d9dc9b996318b18e7c387162a2074f64f0a206aa0b1397b1b41a7","observation_id":"3c8b1e7d-e1fe-416b-8a71-9616440fd572","resolution":{"observed_at":"2026-08-07T10:18:48.972000Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T10:18:35.408685Z","title":"Videoretalking: Audio-based lip synchronization for talking head video editing in the wild","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2506.05851","last_updated":"2025-06-06T08:10:54Z","snapshot_observed_at":"2026-08-17T18:47:06.521919Z","submitted_at":"2025-06-06T08:10:54Z","title":"DeepFake Doctor: Diagnosing and Treating Audio-Video Fake Detection","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-07T10:18:35.408685Z"},"links":{"citing_paper":"/paper/2506.05851"},"observation_digest":"sha256:604a245dd958e6ba26bd411e6e3fbdb30938adb7500d7158947b07ebb1458103","observation_id":"3806f93c-6950-4cbc-ae85-995f0582eae6","resolution":{"observed_at":"2026-08-07T10:18:35.408685Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T10:18:35.527022Z","title":"Not made for each other- audio-visual dissonance-based deepfake detection and localization","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2506.05851","last_updated":"2025-06-06T08:10:54Z","snapshot_observed_at":"2026-08-17T18:47:06.521919Z","submitted_at":"2025-06-06T08:10:54Z","title":"DeepFake Doctor: Diagnosing and Treating Audio-Video Fake Detection","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-07T10:18:35.527022Z"},"links":{"citing_paper":"/paper/2506.05851"},"observation_digest":"sha256:d0e96bfbaaa21b3742ca14605f7353d18ce872a85607cfe2530e83862c97de92","observation_id":"3fba45a1-227d-4c02-a7cb-0a40b8dc8933","resolution":{"observed_at":"2026-08-07T10:18:35.527022Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T10:18:48.529368Z","title":null,"venue":null,"work_id":"01a053e7-8113-4d82-8d9e-58fc39dee51a","year":2018},"citing_paper":{"arxiv_id":"2506.05851","last_updated":"2025-06-06T08:10:54Z","snapshot_observed_at":"2026-08-17T18:47:06.521919Z","submitted_at":"2025-06-06T08:10:54Z","title":"DeepFake Doctor: Diagnosing and Treating Audio-Video Fake Detection","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-07T10:18:35.686358Z"},"links":{"citing_paper":"/paper/2506.05851"},"observation_digest":"sha256:2637fe09f1a3643d20ac1096df879221bdfa4e5c2ae91076cb05d055058b0f44","observation_id":"1ee450fe-2506-44c7-aeb1-4ecdcaea66cb","resolution":{"observed_at":"2026-08-07T10:18:48.657179Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1910.08854","last_updated":"2019-10-23T18:47:35Z","snapshot_observed_at":"2026-08-15T13:04:24.885978Z","submitted_at":"2019-10-19T22:35:52Z","title":"The Deepfake Detection Challenge (DFDC) Preview Dataset","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1910.08854","snapshot_observed_at":"2026-08-07T10:18:35.823824Z","title":"The deepfake detection challenge (DFDC) preview dataset.CoRR, abs/1910.08854, 2019","venue":null,"work_id":null,"year":1910},"citing_paper":{"arxiv_id":"2506.05851","last_updated":"2025-06-06T08:10:54Z","snapshot_observed_at":"2026-08-17T18:47:06.521919Z","submitted_at":"2025-06-06T08:10:54Z","title":"DeepFake Doctor: Diagnosing and Treating Audio-Video Fake Detection","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-07T10:18:35.823824Z"},"links":{"cited_paper":"/paper/1910.08854","citing_paper":"/paper/2506.05851"},"observation_digest":"sha256:9b3bd7a82d2440150955c83e195bd715074bd051125a2fe8a7f479c0bb91a1ae","observation_id":"4fb05eb3-63b2-4f99-94dd-b2250659033f","resolution":{"observed_at":"2026-08-07T10:18:35.823824Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T10:18:48.192474Z","title":"ElevenLabs: Free Text to Speech & AI Voice Generator","venue":null,"work_id":"b27aa18d-38de-4d24-8b05-0a2f0052b9c8","year":2024},"citing_paper":{"arxiv_id":"2506.05851","last_updated":"2025-06-06T08:10:54Z","snapshot_observed_at":"2026-08-17T18:47:06.521919Z","submitted_at":"2025-06-06T08:10:54Z","title":"DeepFake Doctor: Diagnosing and Treating Audio-Video Fake Detection","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-07T10:18:35.991387Z"},"links":{"citing_paper":"/paper/2506.05851"},"observation_digest":"sha256:f63b40a21508d257bee882d403ed389e40c43bf5b7e6d25f88b8e70586d5fbc6","observation_id":"550595e7-6821-4d0a-9178-d31a11ef109e","resolution":{"observed_at":"2026-08-07T10:18:48.367499Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T10:18:47.880364Z","title":"Self-supervised video forensics by audio-visual anomaly detection","venue":null,"work_id":"19ec73ae-1b82-409a-9aef-dea79416b198","year":2023},"citing_paper":{"arxiv_id":"2506.05851","last_updated":"2025-06-06T08:10:54Z","snapshot_observed_at":"2026-08-17T18:47:06.521919Z","submitted_at":"2025-06-06T08:10:54Z","title":"DeepFake Doctor: Diagnosing and Treating Audio-Video Fake Detection","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-07T10:18:36.123870Z"},"links":{"citing_paper":"/paper/2506.05851"},"observation_digest":"sha256:1cbf1fcef96048e5eb0c7f8ee5b4fd6162429f036a5258c80b00663139392109","observation_id":"1e426f45-ccae-4559-b885-cdc6124083b4","resolution":{"observed_at":"2026-08-07T10:18:48.009313Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T10:18:36.280656Z","title":null,"venue":null,"work_id":null,"year":1952},"citing_paper":{"arxiv_id":"2506.05851","last_updated":"2025-06-06T08:10:54Z","snapshot_observed_at":"2026-08-17T18:47:06.521919Z","submitted_at":"2025-06-06T08:10:54Z","title":"DeepFake Doctor: Diagnosing and Treating Audio-Video Fake Detection","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-07T10:18:36.280656Z"},"links":{"citing_paper":"/paper/2506.05851"},"observation_digest":"sha256:19446f0bffbe623d125307dc01a1909eed81fe9ca469b3f8da1d95e1f8f48800","observation_id":"7bf25df6-d26f-4dbf-8e19-cf8922e84231","resolution":{"observed_at":"2026-08-07T10:18:36.280656Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T10:18:36.414438Z","title":"Spatiotemporal inconsistency learning for deepfake video detection","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2506.05851","last_updated":"2025-06-06T08:10:54Z","snapshot_observed_at":"2026-08-17T18:47:06.521919Z","submitted_at":"2025-06-06T08:10:54Z","title":"DeepFake Doctor: Diagnosing and Treating Audio-Video Fake Detection","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-07T10:18:36.414438Z"},"links":{"citing_paper":"/paper/2506.05851"},"observation_digest":"sha256:eeb6981a97f4e842254e36404e6c13be6f999aeaecf25100b62f04779ab147aa","observation_id":"44130256-47ba-405b-867d-34fe04e45508","resolution":{"observed_at":"2026-08-07T10:18:36.414438Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"2022.01453","doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T10:18:43.095812Z","title":"Leveraging real talking faces via self-supervision for robust forgery detection","venue":null,"work_id":"e9bb8ae2-b38c-4a14-a6bb-ee47478b6ac7","year":2022},"citing_paper":{"arxiv_id":"2506.05851","last_updated":"2025-06-06T08:10:54Z","snapshot_observed_at":"2026-08-17T18:47:06.521919Z","submitted_at":"2025-06-06T08:10:54Z","title":"DeepFake Doctor: Diagnosing and Treating Audio-Video Fake Detection","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-07T10:18:36.727650Z"},"links":{"citing_paper":"/paper/2506.05851"},"observation_digest":"sha256:66572100f7971f2daf1f448a0d6a278823bc25ffce71455d7a4fa8511a9615df","observation_id":"2287872a-fb16-4e1a-b5a7-56a913bb8864","resolution":{"observed_at":"2026-08-07T10:18:43.182725Z","resolver_source":"raw_fallback","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T10:18:36.840206Z","title":"Forgerynet: A versatile benchmark for comprehensive forgery analysis","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2506.05851","last_updated":"2025-06-06T08:10:54Z","snapshot_observed_at":"2026-08-17T18:47:06.521919Z","submitted_at":"2025-06-06T08:10:54Z","title":"DeepFake Doctor: Diagnosing and Treating Audio-Video Fake Detection","version":1},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-07T10:18:36.840206Z"},"links":{"citing_paper":"/paper/2506.05851"},"observation_digest":"sha256:9691e5b119c7724c9b9d2dde9daa4c1e2060b48633e49a6397d56321e9919c21","observation_id":"f2571ef6-a702-4a8b-b719-ca962c4465d2","resolution":{"observed_at":"2026-08-07T10:18:36.840206Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2405.08838","last_updated":"2024-05-14T06:40:05Z","snapshot_observed_at":"2026-08-17T13:36:17.804560Z","submitted_at":"2024-05-14T06:40:05Z","title":"PolyGlotFake: A Novel Multilingual and Multimodal DeepFake Dataset","version":1},"cited_work":{"arxiv_id":"2405.08838","doi":"10.48550/arxiv.2405.08838","metadata_source":"pith","pith_arxiv_id":"2405.08838","snapshot_observed_at":"2026-08-10T05:30:23.456663Z","title":"PolyGlotFake: A Novel Multilingual and Multimodal DeepFake Dataset","venue":"cs.SD","work_id":"afac1827-921c-4237-ac47-d888f66a373f","year":2024},"citing_paper":{"arxiv_id":"2506.05851","last_updated":"2025-06-06T08:10:54Z","snapshot_observed_at":"2026-08-17T18:47:06.521919Z","submitted_at":"2025-06-06T08:10:54Z","title":"DeepFake Doctor: Diagnosing and Treating Audio-Video Fake Detection","version":1},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-07T10:18:36.977932Z"},"links":{"cited_paper":"/paper/2405.08838","citing_paper":"/paper/2506.05851"},"observation_digest":"sha256:910c3f3eea41173ac39bf6388e8fc943e41d1ba4a9157257b7883f0ac492ee50","observation_id":"5cec82e8-4ef9-4aab-8b1c-b9180840ec97","resolution":{"observed_at":"2026-08-07T10:18:41.297397Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T10:18:47.583973Z","title":"Deepfakes and their impact on society, Feb 2024","venue":null,"work_id":"69590cd8-5646-4cd4-8749-460e3ea1bcd5","year":2024},"citing_paper":{"arxiv_id":"2506.05851","last_updated":"2025-06-06T08:10:54Z","snapshot_observed_at":"2026-08-17T18:47:06.521919Z","submitted_at":"2025-06-06T08:10:54Z","title":"DeepFake Doctor: Diagnosing and Treating Audio-Video Fake Detection","version":1},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-07T10:18:37.036609Z"},"links":{"citing_paper":"/paper/2506.05851"},"observation_digest":"sha256:bb5eca266de660dce64d887e6aeb6beb60fdf67d4d24598fbab1e2171ff92d2a","observation_id":"e965ea21-0790-4c61-b9ad-22ab694cd5e3","resolution":{"observed_at":"2026-08-07T10:18:47.692602Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T10:18:47.218670Z","title":"Weiss, Quan Wang, Jonathan Shen, Fei Ren, Zhifeng Chen, Patrick Nguyen, Ruoming Pang, Ignacio López-Moreno, and Yonghui Wu","venue":null,"work_id":"dcff0741-15ea-4858-abf8-a377cbdc1771","year":2018},"citing_paper":{"arxiv_id":"2506.05851","last_updated":"2025-06-06T08:10:54Z","snapshot_observed_at":"2026-08-17T18:47:06.521919Z","submitted_at":"2025-06-06T08:10:54Z","title":"DeepFake Doctor: Diagnosing and Treating Audio-Video Fake Detection","version":1},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-07T10:18:37.185765Z"},"links":{"citing_paper":"/paper/2506.05851"},"observation_digest":"sha256:675823a84222978a3155075bdea01fec91d15ac3e9952be5a12b92d29623f63f","observation_id":"1568a3ee-c208-45b7-8c42-949c5ea49ee4","resolution":{"observed_at":"2026-08-07T10:18:47.378731Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T10:18:46.936505Z","title":"Revisiting generalizability in deepfake detection: Improving metrics and stabilizing transfer","venue":null,"work_id":"2ab6d60b-3e67-4f6e-a8fc-626df1586cc5","year":2023},"citing_paper":{"arxiv_id":"2506.05851","last_updated":"2025-06-06T08:10:54Z","snapshot_observed_at":"2026-08-17T18:47:06.521919Z","submitted_at":"2025-06-06T08:10:54Z","title":"DeepFake Doctor: Diagnosing and Treating Audio-Video Fake Detection","version":1},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-07T10:18:37.340240Z"},"links":{"citing_paper":"/paper/2506.05851"},"observation_digest":"sha256:57600e52e1b432a36791bb37757e784c5ac16ac0a3c016c8cb53ebdce9106315","observation_id":"0c80c111-ad3e-4630-9443-2e89293ce9d5","resolution":{"observed_at":"2026-08-07T10:18:47.093958Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T10:18:46.617036Z","title":null,"venue":null,"work_id":"7e35239d-fa09-4ae9-aa9a-cb7dfcb60a4f","year":2021},"citing_paper":{"arxiv_id":"2506.05851","last_updated":"2025-06-06T08:10:54Z","snapshot_observed_at":"2026-08-17T18:47:06.521919Z","submitted_at":"2025-06-06T08:10:54Z","title":"DeepFake Doctor: Diagnosing and Treating Audio-Video Fake Detection","version":1},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-08-07T10:18:37.462225Z"},"links":{"citing_paper":"/paper/2506.05851"},"observation_digest":"sha256:a0933261729080e74a6b5ca9847f6d3b8802c38ae85ec0b5fbec364f8bc15a24","observation_id":"9b2ffe8b-0cc3-4926-bd6d-db2fb6322b15","resolution":{"observed_at":"2026-08-07T10:18:46.748930Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T10:18:37.662506Z","title":"Fast face-swap using con- volutional neural networks","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2506.05851","last_updated":"2025-06-06T08:10:54Z","snapshot_observed_at":"2026-08-17T18:47:06.521919Z","submitted_at":"2025-06-06T08:10:54Z","title":"DeepFake Doctor: Diagnosing and Treating Audio-Video Fake Detection","version":1},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-08-07T10:18:37.662506Z"},"links":{"citing_paper":"/paper/2506.05851"},"observation_digest":"sha256:a426dc65eedcf2e77b9e0707962373dd7c5e427ebff87554eb74d31dc8a8f278","observation_id":"43e10c6a-d2d0-44a2-95c9-2cf90bcadf9c","resolution":{"observed_at":"2026-08-07T10:18:37.662506Z","resolver_source":null,"status":"malformed_identifier"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2411.10193","last_updated":"2025-04-11T06:56:20Z","snapshot_observed_at":"2026-08-16T06:10:19.133076Z","submitted_at":"2024-11-15T13:47:33Z","title":"DiMoDif: Discourse Modality-information Differentiation for Audio-visual Deepfake Detection and Localization","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2411.10193","snapshot_observed_at":"2026-08-07T10:18:37.830717Z","title":"Dimodif: Discourse modality-information differen- tiation for audio-visual deepfake detection and localization.CoRR, abs/2411.10193, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.05851","last_updated":"2025-06-06T08:10:54Z","snapshot_observed_at":"2026-08-17T18:47:06.521919Z","submitted_at":"2025-06-06T08:10:54Z","title":"DeepFake Doctor: Diagnosing and Treating Audio-Video Fake Detection","version":1},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-08-07T10:18:37.830717Z"},"links":{"cited_paper":"/paper/2411.10193","citing_paper":"/paper/2506.05851"},"observation_digest":"sha256:e75fac7ca2a18423e0ac2b3b101b59eb9880fd745fd7ce3af8b38dc8b47b5fcd","observation_id":"96394362-d0dc-478a-bf7d-d7b9b080d66c","resolution":{"observed_at":"2026-08-07T10:18:37.830717Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T10:18:46.289272Z","title":"Kodf: A large-scale korean deepfake detection dataset","venue":null,"work_id":"abdcf3c3-e44a-4ef9-adf3-17d9f27e73a5","year":2021},"citing_paper":{"arxiv_id":"2506.05851","last_updated":"2025-06-06T08:10:54Z","snapshot_observed_at":"2026-08-17T18:47:06.521919Z","submitted_at":"2025-06-06T08:10:54Z","title":"DeepFake Doctor: Diagnosing and Treating Audio-Video Fake Detection","version":1},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-08-07T10:18:37.994764Z"},"links":{"citing_paper":"/paper/2506.05851"},"observation_digest":"sha256:9cdc70a55d692b1de61a550c005d4ea57ab8960b4cdb8cbd77d4aabe5774b6c5","observation_id":"03a3f80c-a08a-454c-894f-1b5f31d40cbd","resolution":{"observed_at":"2026-08-07T10:18:46.437415Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T10:18:46.113782Z","title":"Speechforensics: Audio-visual speech represen- tation learning for face forgery detection","venue":null,"work_id":"6fb3f5c1-30c9-4d28-ab16-4df5e4f9005c","year":2024},"citing_paper":{"arxiv_id":"2506.05851","last_updated":"2025-06-06T08:10:54Z","snapshot_observed_at":"2026-08-17T18:47:06.521919Z","submitted_at":"2025-06-06T08:10:54Z","title":"DeepFake Doctor: Diagnosing and Treating Audio-Video Fake Detection","version":1},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-08-07T10:18:38.474126Z"},"links":{"citing_paper":"/paper/2506.05851"},"observation_digest":"sha256:2903ca8f7ce844b3bd39bde8da654e8421749777b0a7f30c032a86779053b14d","observation_id":"e3fce336-49f9-420d-8d68-205964c00070","resolution":{"observed_at":"2026-08-07T10:18:46.188229Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T10:18:45.881902Z","title":"Lips are lying: Spotting the temporal inconsistency between audio and visual in lip-syncing deepfakes","venue":null,"work_id":"ef17498b-d5b4-4bff-bb08-37ff01974f61","year":2024},"citing_paper":{"arxiv_id":"2506.05851","last_updated":"2025-06-06T08:10:54Z","snapshot_observed_at":"2026-08-17T18:47:06.521919Z","submitted_at":"2025-06-06T08:10:54Z","title":"DeepFake Doctor: Diagnosing and Treating Audio-Video Fake Detection","version":1},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-08-07T10:18:38.579454Z"},"links":{"citing_paper":"/paper/2506.05851"},"observation_digest":"sha256:8601aa3fde873273122f93efa4c51fcc7d67633f9dbfd250edf72f155c2d015e","observation_id":"ae3834d0-e49d-47fb-ae37-6eba138d6cf4","resolution":{"observed_at":"2026-08-07T10:18:45.975597Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T10:18:45.625498Z","title":"Emotions don’t lie: An audio-visual deepfake detection method using affective cues","venue":null,"work_id":"0cec5649-8dd0-4976-93ec-8a86591a6732","year":2020},"citing_paper":{"arxiv_id":"2506.05851","last_updated":"2025-06-06T08:10:54Z","snapshot_observed_at":"2026-08-17T18:47:06.521919Z","submitted_at":"2025-06-06T08:10:54Z","title":"DeepFake Doctor: Diagnosing and Treating Audio-Video Fake Detection","version":1},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-08-07T10:18:38.755159Z"},"links":{"citing_paper":"/paper/2506.05851"},"observation_digest":"sha256:d3f9608c800e6df4eeacd1e2e7c0ea1519e82d6bc098adfdba6514767561e190","observation_id":"4bf0d71d-cfb8-4fb8-85f6-3ba254e11c2b","resolution":{"observed_at":"2026-08-07T10:18:45.762206Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"2023.00939","doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T10:18:42.744000Z","title":"Df-platter: Multi-face heterogeneous deepfake dataset","venue":null,"work_id":"78c53414-9ba7-4d3a-b2cc-83efa991043f","year":2023},"citing_paper":{"arxiv_id":"2506.05851","last_updated":"2025-06-06T08:10:54Z","snapshot_observed_at":"2026-08-17T18:47:06.521919Z","submitted_at":"2025-06-06T08:10:54Z","title":"DeepFake Doctor: Diagnosing and Treating Audio-Video Fake Detection","version":1},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-08-07T10:18:38.952692Z"},"links":{"citing_paper":"/paper/2506.05851"},"observation_digest":"sha256:21033330d76255473da236bb83d85834b95e9bdc4c243fbef34de2a07b7aab24","observation_id":"754a0db5-4509-4c03-89e3-e11c5c2b8c0c","resolution":{"observed_at":"2026-08-07T10:18:42.849268Z","resolver_source":"raw_fallback","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T10:18:39.097410Z","title":"BYOL for audio: Self-supervised learning for general-purpose audio representation","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2506.05851","last_updated":"2025-06-06T08:10:54Z","snapshot_observed_at":"2026-08-17T18:47:06.521919Z","submitted_at":"2025-06-06T08:10:54Z","title":"DeepFake Doctor: Diagnosing and Treating Audio-Video Fake Detection","version":1},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-08-07T10:18:39.097410Z"},"links":{"citing_paper":"/paper/2506.05851"},"observation_digest":"sha256:9c0a080bd741f8f8c7d4fb89d98c214974f8be7f56a327ac89b9d640a91562dc","observation_id":"e0742caa-fdfb-4b25-8e85-ea301dcf5c9d","resolution":{"observed_at":"2026-08-07T10:18:39.097410Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T10:18:39.234661Z","title":"FSGAN: subject agnostic face swapping and reenactment","venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2506.05851","last_updated":"2025-06-06T08:10:54Z","snapshot_observed_at":"2026-08-17T18:47:06.521919Z","submitted_at":"2025-06-06T08:10:54Z","title":"DeepFake Doctor: Diagnosing and Treating Audio-Video Fake Detection","version":1},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-08-07T10:18:39.234661Z"},"links":{"citing_paper":"/paper/2506.05851"},"observation_digest":"sha256:e15bce09f95551a8b95493af3dea5fb99ed814cfc289786d7ef6375dcd195862","observation_id":"e89a7697-22d6-4497-af9b-48f585966a2a","resolution":{"observed_at":"2026-08-07T10:18:39.234661Z","resolver_source":null,"status":"malformed_identifier"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T10:18:39.343411Z","title":"A VFF: audio-visual feature fusion for video deep- fake detection","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.05851","last_updated":"2025-06-06T08:10:54Z","snapshot_observed_at":"2026-08-17T18:47:06.521919Z","submitted_at":"2025-06-06T08:10:54Z","title":"DeepFake Doctor: Diagnosing and Treating Audio-Video Fake Detection","version":1},"reference_index":36,"source":"pdf_text","source_observed_at":"2026-08-07T10:18:39.343411Z"},"links":{"citing_paper":"/paper/2506.05851"},"observation_digest":"sha256:e70ddeb82a0f4e1b613b5e8f20ef74852cb99f47d798b6ac27ab97551525414d","observation_id":"e9b7e56b-75c3-4e75-b4d8-6b72b3b0171d","resolution":{"observed_at":"2026-08-07T10:18:39.343411Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T10:18:39.434600Z","title":null,"venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2506.05851","last_updated":"2025-06-06T08:10:54Z","snapshot_observed_at":"2026-08-17T18:47:06.521919Z","submitted_at":"2025-06-06T08:10:54Z","title":"DeepFake Doctor: Diagnosing and Treating Audio-Video Fake Detection","version":1},"reference_index":37,"source":"pdf_text","source_observed_at":"2026-08-07T10:18:39.434600Z"},"links":{"citing_paper":"/paper/2506.05851"},"observation_digest":"sha256:30bdffe05e9a933b61554fd7ac57d03a586dbf406c65d0fbd7adaac435189367","observation_id":"8525d7f7-0d25-4e89-b38a-3f67fc0098d1","resolution":{"observed_at":"2026-08-07T10:18:39.434600Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T10:18:39.576824Z","title":"Multimodaltrace: Deepfake detection using audiovisual representation learning","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.05851","last_updated":"2025-06-06T08:10:54Z","snapshot_observed_at":"2026-08-17T18:47:06.521919Z","submitted_at":"2025-06-06T08:10:54Z","title":"DeepFake Doctor: Diagnosing and Treating Audio-Video Fake Detection","version":1},"reference_index":38,"source":"pdf_text","source_observed_at":"2026-08-07T10:18:39.576824Z"},"links":{"citing_paper":"/paper/2506.05851"},"observation_digest":"sha256:864864d6afa9e37a9da9aee429350cd27496b197de7c52c1879478b9aba532e8","observation_id":"228e61de-e17a-469f-aece-520079c1ad5f","resolution":{"observed_at":"2026-08-07T10:18:39.576824Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T10:18:39.675418Z","title":"Faceforensics++: Learning to detect manipulated facial images","venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2506.05851","last_updated":"2025-06-06T08:10:54Z","snapshot_observed_at":"2026-08-17T18:47:06.521919Z","submitted_at":"2025-06-06T08:10:54Z","title":"DeepFake Doctor: Diagnosing and Treating Audio-Video Fake Detection","version":1},"reference_index":39,"source":"pdf_text","source_observed_at":"2026-08-07T10:18:39.675418Z"},"links":{"citing_paper":"/paper/2506.05851"},"observation_digest":"sha256:663d059153365f8bb2d4cd427a657e9dae402f43cf1d2d5f22963b5b201d755e","observation_id":"51baf870-57bd-40ca-85e3-30826a359ac7","resolution":{"observed_at":"2026-08-07T10:18:39.675418Z","resolver_source":null,"status":"malformed_identifier"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T10:18:45.437086Z","title":"Facefusion.https://github.com/facefusion/facefusion, 2024","venue":null,"work_id":"b0534096-f522-4305-99c2-7a4e38d70517","year":2024},"citing_paper":{"arxiv_id":"2506.05851","last_updated":"2025-06-06T08:10:54Z","snapshot_observed_at":"2026-08-17T18:47:06.521919Z","submitted_at":"2025-06-06T08:10:54Z","title":"DeepFake Doctor: Diagnosing and Treating Audio-Video Fake Detection","version":1},"reference_index":40,"source":"pdf_text","source_observed_at":"2026-08-07T10:18:39.799085Z"},"links":{"citing_paper":"/paper/2506.05851"},"observation_digest":"sha256:def049a28f64872cc6d5eea486683266c8f0e1aa0eaf8349ff0cf963804830eb","observation_id":"f4c909d7-ae70-47ab-b9d4-d9b9e97e3685","resolution":{"observed_at":"2026-08-07T10:18:45.539321Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"7947.36080","doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T10:18:42.026493Z","title":null,"venue":null,"work_id":"eb26d4a4-6246-4176-bc15-ef1322f0f489","year":2023},"citing_paper":{"arxiv_id":"2506.05851","last_updated":"2025-06-06T08:10:54Z","snapshot_observed_at":"2026-08-17T18:47:06.521919Z","submitted_at":"2025-06-06T08:10:54Z","title":"DeepFake Doctor: Diagnosing and Treating Audio-Video Fake Detection","version":1},"reference_index":41,"source":"pdf_text","source_observed_at":"2026-08-07T10:18:39.881395Z"},"links":{"citing_paper":"/paper/2506.05851"},"observation_digest":"sha256:0ab08b78cdf1ff4698fad2c7927d7f2bb5682b4b74419d87f72ba444e7f7b71f","observation_id":"c60b9fc1-9ce8-4a09-8700-f2a8ba2e0276","resolution":{"observed_at":"2026-08-07T10:18:42.107402Z","resolver_source":"raw_fallback","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2311.17088","last_updated":"2024-06-20T20:24:59Z","snapshot_observed_at":"2026-08-16T14:39:48.028176Z","submitted_at":"2023-11-28T03:28:19Z","title":"Unsupervised Multimodal Deepfake Detection Using Intra- and Cross-Modal Inconsistencies","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2311.17088","snapshot_observed_at":"2026-08-07T10:18:39.977883Z","title":"Unsupervised multi- modal deepfake detection using intra- and cross-modal inconsistencies.CoRR, abs/2311.17088,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2506.05851","last_updated":"2025-06-06T08:10:54Z","snapshot_observed_at":"2026-08-17T18:47:06.521919Z","submitted_at":"2025-06-06T08:10:54Z","title":"DeepFake Doctor: Diagnosing and Treating Audio-Video Fake Detection","version":1},"reference_index":42,"source":"pdf_text","source_observed_at":"2026-08-07T10:18:39.977883Z"},"links":{"cited_paper":"/paper/2311.17088","citing_paper":"/paper/2506.05851"},"observation_digest":"sha256:1885ddb2445a7659428a3dd0eaa407c5cbcbd0141bedf2598ed736251b98a91e","observation_id":"dc4fa2ff-1c45-4880-b240-6d4a3d230ae6","resolution":{"observed_at":"2026-08-07T10:18:39.977883Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T10:18:40.238556Z","title":"A closer look at spatiotemporal convolutions for action recognition","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2506.05851","last_updated":"2025-06-06T08:10:54Z","snapshot_observed_at":"2026-08-17T18:47:06.521919Z","submitted_at":"2025-06-06T08:10:54Z","title":"DeepFake Doctor: Diagnosing and Treating Audio-Video Fake Detection","version":1},"reference_index":43,"source":"pdf_text","source_observed_at":"2026-08-07T10:18:40.238556Z"},"links":{"citing_paper":"/paper/2506.05851"},"observation_digest":"sha256:035f3584da77747974709d4c5e8efaf1670fdb93013f643d410d32d2eadb5b9e","observation_id":"b9f2c399-abe0-43e3-946b-4c0adcea4a2e","resolution":{"observed_at":"2026-08-07T10:18:40.238556Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":"10.1007/978-3-031-43153-1","metadata_source":"openalex","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T00:03:56.115653Z","title":"Deepfakes audio detection leveraging audio spectrogram and convolutional neural networks","venue":"Lecture notes in computer science","work_id":"f472118b-caf0-4ee8-9697-e7478d368c11","year":2023},"citing_paper":{"arxiv_id":"2506.05851","last_updated":"2025-06-06T08:10:54Z","snapshot_observed_at":"2026-08-17T18:47:06.521919Z","submitted_at":"2025-06-06T08:10:54Z","title":"DeepFake Doctor: Diagnosing and Treating Audio-Video Fake Detection","version":1},"reference_index":44,"source":"pdf_text","source_observed_at":"2026-08-07T10:18:40.294725Z"},"links":{"citing_paper":"/paper/2506.05851"},"observation_digest":"sha256:94e270aaa7b26b4e18d2ce2e641c430eaf1bb0fd70fe67f1646de98b4db5f2f9","observation_id":"bddfc92f-ec1d-4dd9-9fed-1d30545f29c8","resolution":{"observed_at":"2026-08-07T10:18:40.996484Z","resolver_source":"doi","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T10:18:45.145379Z","title":"Abc-capsnet: Attention based cascaded capsule network for audio deepfake detection","venue":null,"work_id":"c9694a0d-f415-4131-82be-12e89a2fd29d","year":2024},"citing_paper":{"arxiv_id":"2506.05851","last_updated":"2025-06-06T08:10:54Z","snapshot_observed_at":"2026-08-17T18:47:06.521919Z","submitted_at":"2025-06-06T08:10:54Z","title":"DeepFake Doctor: Diagnosing and Treating Audio-Video Fake Detection","version":1},"reference_index":45,"source":"pdf_text","source_observed_at":"2026-08-07T10:18:40.385598Z"},"links":{"citing_paper":"/paper/2506.05851"},"observation_digest":"sha256:349421bf59c471f178ccff845154d1d2b1c5a85102a54957667a327b253b2c00","observation_id":"a83e6824-73e2-4ef0-a2d9-82b2a48369c1","resolution":{"observed_at":"2026-08-07T10:18:45.304466Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T10:18:40.494965Z","title":"Audio deepfake detection system with neural stitching for ADD 2022","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2506.05851","last_updated":"2025-06-06T08:10:54Z","snapshot_observed_at":"2026-08-17T18:47:06.521919Z","submitted_at":"2025-06-06T08:10:54Z","title":"DeepFake Doctor: Diagnosing and Treating Audio-Video Fake Detection","version":1},"reference_index":46,"source":"pdf_text","source_observed_at":"2026-08-07T10:18:40.494965Z"},"links":{"citing_paper":"/paper/2506.05851"},"observation_digest":"sha256:37269be9209fa06bb9ea6f7df6c4172d001a38ab61ec6f23ef2b1196d746bb8d","observation_id":"46def09e-f4c3-495b-9cc4-e5e586cbecd5","resolution":{"observed_at":"2026-08-07T10:18:40.494965Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T10:18:40.532283Z","title":"Avoid-df: Audio-visual joint learning for detecting deepfake.IEEE Trans","venue":null,"work_id":null,"year":2015},"citing_paper":{"arxiv_id":"2506.05851","last_updated":"2025-06-06T08:10:54Z","snapshot_observed_at":"2026-08-17T18:47:06.521919Z","submitted_at":"2025-06-06T08:10:54Z","title":"DeepFake Doctor: Diagnosing and Treating Audio-Video Fake Detection","version":1},"reference_index":47,"source":"pdf_text","source_observed_at":"2026-08-07T10:18:40.532283Z"},"links":{"citing_paper":"/paper/2506.05851"},"observation_digest":"sha256:dc02c96dde7a43d3a5f4c11c6d293ba70f5276fcbbee6eba3fc85d6bd284af5c","observation_id":"72324672-143b-4265-98a6-51a2a96795e4","resolution":{"observed_at":"2026-08-07T10:18:40.532283Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T10:18:44.841128Z","title":"Joint face detection and alignment using multitask cascaded convolutional networks.IEEE signal processing letters, 23(10): 1499–1503, 2016","venue":null,"work_id":"5e506304-b9fd-49e4-86af-c9aecd8bf576","year":2016},"citing_paper":{"arxiv_id":"2506.05851","last_updated":"2025-06-06T08:10:54Z","snapshot_observed_at":"2026-08-17T18:47:06.521919Z","submitted_at":"2025-06-06T08:10:54Z","title":"DeepFake Doctor: Diagnosing and Treating Audio-Video Fake Detection","version":1},"reference_index":48,"source":"pdf_text","source_observed_at":"2026-08-07T10:18:40.621662Z"},"links":{"citing_paper":"/paper/2506.05851"},"observation_digest":"sha256:6ff94dc9816559a685a41319c35818d3f5cd47cb0cb6418abcd7c1e5d866b371","observation_id":"15d6c69a-8c75-46c0-81b1-fc7b71a009cd","resolution":{"observed_at":"2026-08-07T10:18:45.002570Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T10:18:44.574952Z","title":"Exploring temporal coherence for more general video face forgery detection","venue":null,"work_id":"e5ec08b6-2cfb-4868-91d5-14a0242e7213","year":2021},"citing_paper":{"arxiv_id":"2506.05851","last_updated":"2025-06-06T08:10:54Z","snapshot_observed_at":"2026-08-17T18:47:06.521919Z","submitted_at":"2025-06-06T08:10:54Z","title":"DeepFake Doctor: Diagnosing and Treating Audio-Video Fake Detection","version":1},"reference_index":49,"source":"pdf_text","source_observed_at":"2026-08-07T10:18:40.697362Z"},"links":{"citing_paper":"/paper/2506.05851"},"observation_digest":"sha256:fd0d2814ed5b7a3eebabfedf1d2f85627461eb5b3563de4512a2891ff88888da","observation_id":"5bd5cf4a-11af-4f7a-bd31-9ee4101235b5","resolution":{"observed_at":"2026-08-07T10:18:44.715333Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T10:18:44.278803Z","title":null,"venue":null,"work_id":"66715c0d-358c-4281-b00d-fa924e88ae35","year":2022},"citing_paper":{"arxiv_id":"2506.05851","last_updated":"2025-06-06T08:10:54Z","snapshot_observed_at":"2026-08-17T18:47:06.521919Z","submitted_at":"2025-06-06T08:10:54Z","title":"DeepFake Doctor: Diagnosing and Treating Audio-Video Fake Detection","version":1},"reference_index":50,"source":"pdf_text","source_observed_at":"2026-08-07T10:18:40.766574Z"},"links":{"citing_paper":"/paper/2506.05851"},"observation_digest":"sha256:1ad4b45ec5e90e3a2ac7bf970386f79f5b028d9fb4a9408480b167ff2da0c068","observation_id":"228876f4-7a32-4c66-9459-21f024b91279","resolution":{"observed_at":"2026-08-07T10:18:44.419252Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T10:18:44.065910Z","title":"real”/“fake","venue":null,"work_id":"15b8adad-8d65-4cf5-b706-39c9c74ae7b8","year":2021},"citing_paper":{"arxiv_id":"2506.05851","last_updated":"2025-06-06T08:10:54Z","snapshot_observed_at":"2026-08-17T18:47:06.521919Z","submitted_at":"2025-06-06T08:10:54Z","title":"DeepFake Doctor: Diagnosing and Treating Audio-Video Fake Detection","version":1},"reference_index":51,"source":"pdf_text","source_observed_at":"2026-08-07T10:18:40.860197Z"},"links":{"citing_paper":"/paper/2506.05851"},"observation_digest":"sha256:a5372b5a952f908461f7786a49ac4cebb209e6baca0b8788c102d8e9258aaf7e","observation_id":"c71c2684-7bc1-4615-b752-e8678f7d6328","resolution":{"observed_at":"2026-08-07T10:18:44.136851Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2005.00214","last_updated":"2020-05-20T17:40:28Z","snapshot_observed_at":"2026-08-09T00:23:40.293592Z","submitted_at":"2020-05-01T04:17:14Z","title":"The AVA-Kinetics Localized Human Actions Video Dataset","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2005.00214","snapshot_observed_at":"2026-08-07T10:18:38.362189Z","title":null,"venue":null,"work_id":null,"year":2005},"citing_paper":{"arxiv_id":"2506.05851","last_updated":"2025-06-06T08:10:54Z","snapshot_observed_at":"2026-08-17T18:47:06.521919Z","submitted_at":"2025-06-06T08:10:54Z","title":"DeepFake Doctor: Diagnosing and Treating Audio-Video Fake Detection","version":1},"reference_index":2020,"source":"pdf_text","source_observed_at":"2026-08-07T10:18:38.362189Z"},"links":{"cited_paper":"/paper/2005.00214","citing_paper":"/paper/2506.05851"},"observation_digest":"sha256:f102633feba474e6c86a18e9b42397a813372648996efc96a21c2709305f7a40","observation_id":"86d7a5a5-92a7-47e3-bac2-c46bd06143ca","resolution":{"observed_at":"2026-08-07T10:18:38.362189Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2311.17088","last_updated":"2024-06-20T20:24:59Z","snapshot_observed_at":"2026-08-16T14:39:48.028176Z","submitted_at":"2023-11-28T03:28:19Z","title":"Unsupervised Multimodal Deepfake Detection Using Intra- and Cross-Modal Inconsistencies","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2311.17088","snapshot_observed_at":"2026-08-07T10:18:40.105687Z","title":"URL https://doi.org/10.48550/arXiv.2311","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2506.05851","last_updated":"2025-06-06T08:10:54Z","snapshot_observed_at":"2026-08-17T18:47:06.521919Z","submitted_at":"2025-06-06T08:10:54Z","title":"DeepFake Doctor: Diagnosing and Treating Audio-Video Fake Detection","version":1},"reference_index":2023,"source":"pdf_text","source_observed_at":"2026-08-07T10:18:40.105687Z"},"links":{"cited_paper":"/paper/2311.17088","citing_paper":"/paper/2506.05851"},"observation_digest":"sha256:866869e064d2c0be431a81036de744a3afdc1da079cdfef40574679020328296","observation_id":"6cdee18e-af0b-4dca-be3f-381beda201c1","resolution":{"observed_at":"2026-08-07T10:18:40.105687Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":"10.1145/3625231","metadata_source":"openalex","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T05:30:23.456663Z","title":"URLhttps://doi.org/10.1145/3625231","venue":"ACM Transactions on Multimedia Computing Communications and Applications","work_id":"d882521d-38d4-4c9c-87bf-0b94582d9540","year":null},"citing_paper":{"arxiv_id":"2506.05851","last_updated":"2025-06-06T08:10:54Z","snapshot_observed_at":"2026-08-17T18:47:06.521919Z","submitted_at":"2025-06-06T08:10:54Z","title":"DeepFake Doctor: Diagnosing and Treating Audio-Video Fake Detection","version":1},"reference_index":2024,"source":"pdf_text","source_observed_at":"2026-08-07T10:18:35.280372Z"},"links":{"citing_paper":"/paper/2506.05851"},"observation_digest":"sha256:14d69f18d8e1485da5032868202a6688f4bf04ff0d5f13418a5139c8003618b5","observation_id":"2c94da56-2dee-498f-beae-b0b40bdf9276","resolution":{"observed_at":"2026-08-07T10:18:41.519765Z","resolver_source":"doi","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T10:18:34.285971Z","title":"doi: 10.1109/CVPRW50498.2020.00338","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2506.05851","last_updated":"2025-06-06T08:10:54Z","snapshot_observed_at":"2026-08-17T18:47:06.521919Z","submitted_at":"2025-06-06T08:10:54Z","title":"DeepFake Doctor: Diagnosing and Treating Audio-Video Fake Detection","version":1},"reference_index":2822,"source":"pdf_text","source_observed_at":"2026-08-07T10:18:34.285971Z"},"links":{"citing_paper":"/paper/2506.05851"},"observation_digest":"sha256:316a5e2439659804142ad6175c329e682f729175a4e3600d1eac1ac78fb26c80","observation_id":"43e8d5ad-f28d-41d9-b219-91e7264c234b","resolution":{"observed_at":"2026-08-07T10:18:34.285971Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"paper":{"arxiv_id":"2506.05851","last_updated":"2025-06-06T08:10:54Z","latest_version":1,"primary_category":"cs.MM","snapshot_observed_at":"2026-08-17T18:47:06.521919Z","submitted_at":"2025-06-06T08:10:54Z","title":"DeepFake Doctor: Diagnosing and Treating Audio-Video Fake Detection"},"reference_resolution":{"displayed":53,"state_counts":{"malformed_identifier":3,"metadata_mismatch":1,"parse_uncertain":0,"unresolved":25,"verified_exact":5,"verified_fuzzy":19},"total_outbound_references":53},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"thesis":"As of 19 August 2026, this Paper Citation Record lists 53 of 53 outbound references and 0 inbound Pith citation observations for arXiv:2506.05851."}