{"as_of":"2026-08-17T00:20:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:61ec4bccb2c2dad443f51481246952a88f1fcb36b6e3a14fc6f02c791d66a2a2","coverage":[{"denominator":47,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":47,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-15T17:45:47.523057Z","state":"measured"},{"denominator":49,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":49,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-16T06:30:59.297886+00:00","state":"measured"},{"denominator":2,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":2,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-06T11:22:05.863936Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"pith","source_observed_at":"2026-08-05T22:17:26.813384Z","state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2507.20579","last_updated":"2025-07-28T07:27:42Z","snapshot_observed_at":"2026-08-16T17:41:52.568009Z","submitted_at":"2025-07-28T07:27:42Z","title":"AV-Deepfake1M++: A Large-Scale Audio-Visual Deepfake Benchmark with Real-World Perturbations","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2507.20579","snapshot_observed_at":"2026-08-06T11:22:05.863936Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2507.22781","last_updated":"2025-07-30T15:47:12Z","snapshot_observed_at":"2026-08-10T20:25:52.150629Z","submitted_at":"2025-07-30T15:47:12Z","title":"HOLA: Enhancing Audio-visual Deepfake Detection via Hierarchical Contextual Aggregations and Efficient Pre-training","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-06T11:22:05.863936Z"},"links":{"cited_paper":"/paper/2507.20579","citing_paper":"/paper/2507.22781"},"observation_digest":"sha256:527da164abeffd365124ebd9e3feaa784a5971271586974b2e3c62f72e904293","observation_id":"c85ce3f1-f6e2-463a-8fcd-c8df423c9f91","resolution":{"observed_at":"2026-08-06T11:22:05.863936Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2507.20579","last_updated":"2025-07-28T07:27:42Z","snapshot_observed_at":"2026-08-16T17:41:52.568009Z","submitted_at":"2025-07-28T07:27:42Z","title":"AV-Deepfake1M++: A Large-Scale Audio-Visual Deepfake Benchmark with Real-World Perturbations","version":1},"cited_work":{"arxiv_id":"2507.20579","doi":null,"metadata_source":"pith","pith_arxiv_id":"2507.20579","snapshot_observed_at":"2026-08-05T22:17:26.813384Z","title":"AV-Deepfake1M++: A Large-Scale Audio-Visual Deepfake Benchmark with Real-World Perturbations","venue":"cs.CV","work_id":"c4a32274-03f2-4648-afae-42a5a7bd930d","year":2025},"citing_paper":{"arxiv_id":"2508.07337","last_updated":"2025-08-10T13:29:08Z","snapshot_observed_at":"2026-08-16T17:29:26.649700Z","submitted_at":"2025-08-10T13:29:08Z","title":"KLASSify to Verify: Audio-Visual Deepfake Detection Using SSL-based Audio and Handcrafted Visual Features","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-05T22:17:25.381762Z"},"links":{"cited_paper":"/paper/2507.20579","citing_paper":"/paper/2508.07337"},"observation_digest":"sha256:36a04652d3a98e853960a39b72e2bf690f292701bcdc998f15744eab883a7ea4","observation_id":"47a8baa8-4ad1-445f-9b59-851fc8f52547","resolution":{"observed_at":"2026-08-05T22:17:26.817489Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}}],"links":{"evidence":"/evidence","html":"/paper/2507.20579/citation-record","integrity":"/paper/2507.20579/integrity","json":"/paper/2507.20579/citation-record.json","paper":"/paper/2507.20579"},"outbound":[{"citation":{"cited_paper":{"arxiv_id":"1809.00496","last_updated":"2018-10-28T14:29:46Z","snapshot_observed_at":"2026-08-16T06:08:36.265981Z","submitted_at":"2018-09-03T08:38:34Z","title":"LRS3-TED: a large-scale dataset for visual speech recognition","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1809.00496","snapshot_observed_at":"2026-08-15T17:45:47.331324Z","title":null,"venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2507.20579","last_updated":"2025-07-28T07:27:42Z","snapshot_observed_at":"2026-08-16T17:41:52.568009Z","submitted_at":"2025-07-28T07:27:42Z","title":"AV-Deepfake1M++: A Large-Scale Audio-Visual Deepfake Benchmark with Real-World Perturbations","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-15T17:45:47.331324Z"},"links":{"cited_paper":"/paper/1809.00496","citing_paper":"/paper/2507.20579"},"observation_digest":"sha256:e08e3d045b078ad4482424f4215168f8cbc9b36cc2452ddc9c6bd163dc0533f4","observation_id":"a26eaf79-f914-4222-a650-1caffdda91c7","resolution":{"observed_at":"2026-08-15T17:45:47.331324Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T17:45:47.336587Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.20579","last_updated":"2025-07-28T07:27:42Z","snapshot_observed_at":"2026-08-16T17:41:52.568009Z","submitted_at":"2025-07-28T07:27:42Z","title":"AV-Deepfake1M++: A Large-Scale Audio-Visual Deepfake Benchmark with Real-World Perturbations","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-15T17:45:47.336587Z"},"links":{"citing_paper":"/paper/2507.20579"},"observation_digest":"sha256:5515e6708448a5572c0fb07017a3b32a95cf4c0c652460e825b5974bfeb8a43f","observation_id":"495741a5-beb2-4bbc-9f57-6861a538406d","resolution":{"observed_at":"2026-08-15T17:45:47.336587Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T17:45:47.341087Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.20579","last_updated":"2025-07-28T07:27:42Z","snapshot_observed_at":"2026-08-16T17:41:52.568009Z","submitted_at":"2025-07-28T07:27:42Z","title":"AV-Deepfake1M++: A Large-Scale Audio-Visual Deepfake Benchmark with Real-World Perturbations","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-15T17:45:47.341087Z"},"links":{"citing_paper":"/paper/2507.20579"},"observation_digest":"sha256:be3a923feed477b772ae116aabd1b11169cd598b31fff50c58301a009db8e261","observation_id":"26db5360-4435-4855-9efb-ae031f4a0562","resolution":{"observed_at":"2026-08-15T17:45:47.341087Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T17:45:47.345242Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2507.20579","last_updated":"2025-07-28T07:27:42Z","snapshot_observed_at":"2026-08-16T17:41:52.568009Z","submitted_at":"2025-07-28T07:27:42Z","title":"AV-Deepfake1M++: A Large-Scale Audio-Visual Deepfake Benchmark with Real-World Perturbations","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-15T17:45:47.345242Z"},"links":{"citing_paper":"/paper/2507.20579"},"observation_digest":"sha256:df93848e28f2aaa1b7ae6a732863b9c0f26ea6dc491fdf1d0bdad5188d6fa997","observation_id":"e14ce2ce-4009-49c1-8b65-1f479717ea58","resolution":{"observed_at":"2026-08-15T17:45:47.345242Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T17:45:47.349183Z","title":null,"venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2507.20579","last_updated":"2025-07-28T07:27:42Z","snapshot_observed_at":"2026-08-16T17:41:52.568009Z","submitted_at":"2025-07-28T07:27:42Z","title":"AV-Deepfake1M++: A Large-Scale Audio-Visual Deepfake Benchmark with Real-World Perturbations","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-15T17:45:47.349183Z"},"links":{"citing_paper":"/paper/2507.20579"},"observation_digest":"sha256:e27a3c496d9c063cbed916d3683af79bbb6dde45a185a950240f8ff16f568965","observation_id":"7ea67a76-f0e5-4f9c-8375-a05e3d3c1239","resolution":{"observed_at":"2026-08-15T17:45:47.349183Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2406.04904","last_updated":"2024-06-07T12:56:11Z","snapshot_observed_at":"2026-08-16T17:28:53.714216Z","submitted_at":"2024-06-07T12:56:11Z","title":"XTTS: a Massively Multilingual Zero-Shot Text-to-Speech Model","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2406.04904","snapshot_observed_at":"2026-08-15T17:45:47.353222Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.20579","last_updated":"2025-07-28T07:27:42Z","snapshot_observed_at":"2026-08-16T17:41:52.568009Z","submitted_at":"2025-07-28T07:27:42Z","title":"AV-Deepfake1M++: A Large-Scale Audio-Visual Deepfake Benchmark with Real-World Perturbations","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-15T17:45:47.353222Z"},"links":{"cited_paper":"/paper/2406.04904","citing_paper":"/paper/2507.20579"},"observation_digest":"sha256:07aa045c59557a29a49d76b129407bda7d66110d788f12e8a5ea5484748b2a20","observation_id":"3cd6b2ae-2341-4b02-845f-a85ed67504cc","resolution":{"observed_at":"2026-08-15T17:45:47.353222Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T17:45:48.617519Z","title":"Shulby, Arnaldo Candido Junior, Eren Gölge, and Moacir A","venue":null,"work_id":"ba08ff85-783c-4877-a4ee-c2897f7b284f","year":2022},"citing_paper":{"arxiv_id":"2507.20579","last_updated":"2025-07-28T07:27:42Z","snapshot_observed_at":"2026-08-16T17:41:52.568009Z","submitted_at":"2025-07-28T07:27:42Z","title":"AV-Deepfake1M++: A Large-Scale Audio-Visual Deepfake Benchmark with Real-World Perturbations","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-15T17:45:47.358121Z"},"links":{"citing_paper":"/paper/2507.20579"},"observation_digest":"sha256:b31c504d4ccde85f1d4dc5c3804d393073dc7dba911214ca2866b68c39fd0782","observation_id":"39d04e90-5fa6-4ffa-945b-7bdb49d2b963","resolution":{"observed_at":"2026-08-15T17:45:48.621397Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2410.06885","last_updated":"2025-05-20T15:53:10Z","snapshot_observed_at":"2026-08-16T05:58:47.061997Z","submitted_at":"2024-10-09T13:46:34Z","title":"F5-TTS: A Fairytaler that Fakes Fluent and Faithful Speech with Flow Matching","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2410.06885","snapshot_observed_at":"2026-08-15T17:45:47.362050Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2507.20579","last_updated":"2025-07-28T07:27:42Z","snapshot_observed_at":"2026-08-16T17:41:52.568009Z","submitted_at":"2025-07-28T07:27:42Z","title":"AV-Deepfake1M++: A Large-Scale Audio-Visual Deepfake Benchmark with Real-World Perturbations","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-15T17:45:47.362050Z"},"links":{"cited_paper":"/paper/2410.06885","citing_paper":"/paper/2507.20579"},"observation_digest":"sha256:5a26b2a9ca62042d4d63100a260574a754f4d5bf5454125af1b2ee2b80270a41","observation_id":"da185ce6-bc8b-46cb-98bf-f46a739d4530","resolution":{"observed_at":"2026-08-15T17:45:47.362050Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T17:45:48.605431Z","title":null,"venue":null,"work_id":"de093a9b-0380-44ef-b022-a9c3e2bec0e0","year":2017},"citing_paper":{"arxiv_id":"2507.20579","last_updated":"2025-07-28T07:27:42Z","snapshot_observed_at":"2026-08-16T17:41:52.568009Z","submitted_at":"2025-07-28T07:27:42Z","title":"AV-Deepfake1M++: A Large-Scale Audio-Visual Deepfake Benchmark with Real-World Perturbations","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-15T17:45:47.366386Z"},"links":{"citing_paper":"/paper/2507.20579"},"observation_digest":"sha256:0d4ece4cd12d0fabe5cf9804cc4ebfe66cf7a201586436ec8a3d3bd69e21cfa5","observation_id":"df957454-76bd-44e8-a482-cfd771944330","resolution":{"observed_at":"2026-08-15T17:45:48.610090Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T17:45:48.594796Z","title":null,"venue":null,"work_id":"98678218-62e5-45fd-a11c-f0bde2710fe0","year":2018},"citing_paper":{"arxiv_id":"2507.20579","last_updated":"2025-07-28T07:27:42Z","snapshot_observed_at":"2026-08-16T17:41:52.568009Z","submitted_at":"2025-07-28T07:27:42Z","title":"AV-Deepfake1M++: A Large-Scale Audio-Visual Deepfake Benchmark with Real-World Perturbations","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-15T17:45:47.369989Z"},"links":{"citing_paper":"/paper/2507.20579"},"observation_digest":"sha256:1b9b45465f02e2078c8f188a49d705a7b7d28e62971153170e245d59cb163e62","observation_id":"040e93a9-86c0-4f62-af39-73c3d4da0429","resolution":{"observed_at":"2026-08-15T17:45:48.598454Z","resolver_source":"raw_fallback","status":"malformed_identifier"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2006.07397","last_updated":"2020-10-28T03:48:28Z","snapshot_observed_at":"2026-07-06T09:28:36.954658Z","submitted_at":"2020-06-12T18:15:55Z","title":"The DeepFake Detection Challenge (DFDC) Dataset","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2006.07397","snapshot_observed_at":"2026-08-15T17:45:47.373860Z","title":null,"venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2507.20579","last_updated":"2025-07-28T07:27:42Z","snapshot_observed_at":"2026-08-16T17:41:52.568009Z","submitted_at":"2025-07-28T07:27:42Z","title":"AV-Deepfake1M++: A Large-Scale Audio-Visual Deepfake Benchmark with Real-World Perturbations","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-15T17:45:47.373860Z"},"links":{"cited_paper":"/paper/2006.07397","citing_paper":"/paper/2507.20579"},"observation_digest":"sha256:69f9a9f4c749169f861b451179a527a2fa7bdca11d9b7fe677adebec236cbb7b","observation_id":"b7014402-9e66-4526-a04d-4e103424277d","resolution":{"observed_at":"2026-08-15T17:45:47.373860Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T17:45:47.377965Z","title":null,"venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2507.20579","last_updated":"2025-07-28T07:27:42Z","snapshot_observed_at":"2026-08-16T17:41:52.568009Z","submitted_at":"2025-07-28T07:27:42Z","title":"AV-Deepfake1M++: A Large-Scale Audio-Visual Deepfake Benchmark with Real-World Perturbations","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-15T17:45:47.377965Z"},"links":{"citing_paper":"/paper/2507.20579"},"observation_digest":"sha256:5e6b0f6f1b67c47edbdca22594c09147b0a043cb8588052d3c27932d818660a1","observation_id":"7c6b54f4-0787-4ee3-964b-1a77c78e5109","resolution":{"observed_at":"2026-08-15T17:45:47.377965Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T17:45:48.583558Z","title":null,"venue":null,"work_id":"4838557c-5b25-48ad-b210-1607cf7ba007","year":null},"citing_paper":{"arxiv_id":"2507.20579","last_updated":"2025-07-28T07:27:42Z","snapshot_observed_at":"2026-08-16T17:41:52.568009Z","submitted_at":"2025-07-28T07:27:42Z","title":"AV-Deepfake1M++: A Large-Scale Audio-Visual Deepfake Benchmark with Real-World Perturbations","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-15T17:45:47.381534Z"},"links":{"citing_paper":"/paper/2507.20579"},"observation_digest":"sha256:b5daafb97b575ade8e0243ec739639d6746836d7ea91933969ca540761bdf4b7","observation_id":"0a8e2383-efc3-4269-97a6-1c8a47ae6845","resolution":{"observed_at":"2026-08-15T17:45:48.587363Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T17:45:48.572099Z","title":null,"venue":null,"work_id":"d4ef7bff-5616-4ad8-90fa-adfa74f5c169","year":2021},"citing_paper":{"arxiv_id":"2507.20579","last_updated":"2025-07-28T07:27:42Z","snapshot_observed_at":"2026-08-16T17:41:52.568009Z","submitted_at":"2025-07-28T07:27:42Z","title":"AV-Deepfake1M++: A Large-Scale Audio-Visual Deepfake Benchmark with Real-World Perturbations","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-15T17:45:47.389291Z"},"links":{"citing_paper":"/paper/2507.20579"},"observation_digest":"sha256:b979c6795dc192635bac130d8b5e12d90277fa5aca687c0294975d0e76fc1190","observation_id":"7b0d4cc1-02ec-4b9f-b4ea-61e300d35e82","resolution":{"observed_at":"2026-08-15T17:45:48.575715Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T17:45:48.561306Z","title":null,"venue":null,"work_id":"13e735c4-c4a0-495f-b186-7526227f7288","year":null},"citing_paper":{"arxiv_id":"2507.20579","last_updated":"2025-07-28T07:27:42Z","snapshot_observed_at":"2026-08-16T17:41:52.568009Z","submitted_at":"2025-07-28T07:27:42Z","title":"AV-Deepfake1M++: A Large-Scale Audio-Visual Deepfake Benchmark with Real-World Perturbations","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-15T17:45:47.392747Z"},"links":{"citing_paper":"/paper/2507.20579"},"observation_digest":"sha256:b2cd3826015c5d9b9a9a138e9b4fe53c98625478890fd4bd2df10bba4d8a138e","observation_id":"73e08657-02eb-46ca-b670-109e05b7edd5","resolution":{"observed_at":"2026-08-15T17:45:48.565259Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T17:45:48.550836Z","title":null,"venue":null,"work_id":"a5e58295-a13f-4c1d-a6bb-6ee2b57431ee","year":2025},"citing_paper":{"arxiv_id":"2507.20579","last_updated":"2025-07-28T07:27:42Z","snapshot_observed_at":"2026-08-16T17:41:52.568009Z","submitted_at":"2025-07-28T07:27:42Z","title":"AV-Deepfake1M++: A Large-Scale Audio-Visual Deepfake Benchmark with Real-World Perturbations","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-15T17:45:47.401646Z"},"links":{"citing_paper":"/paper/2507.20579"},"observation_digest":"sha256:bae2dcd0fd1f10585d1ab46d208158eb9261b6aaa8a75155c0b699f738f5fcfb","observation_id":"e509621d-7979-4a29-a7aa-a38c8a425c55","resolution":{"observed_at":"2026-08-15T17:45:48.554507Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":"10.1007/978-3-031-78341-8_12","metadata_source":"doi_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T17:45:47.576877Z","title":"In Pattern Recognition, Apostolos Antonacopoulos, Subhasis Chaudhuri, Rama Chel- lappa, Cheng-Lin Liu, Saumik Bhattacharya, and Umapada Pal (Eds.)","venue":null,"work_id":"dcbee93a-4b83-491d-a319-357c31544f8f","year":null},"citing_paper":{"arxiv_id":"2507.20579","last_updated":"2025-07-28T07:27:42Z","snapshot_observed_at":"2026-08-16T17:41:52.568009Z","submitted_at":"2025-07-28T07:27:42Z","title":"AV-Deepfake1M++: A Large-Scale Audio-Visual Deepfake Benchmark with Real-World Perturbations","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-15T17:45:47.397272Z"},"links":{"citing_paper":"/paper/2507.20579"},"observation_digest":"sha256:7c50f95a7f5d123288bf059f82eeecb7222593bdeee1abdd5ee01d356b5e9217","observation_id":"58a89ceb-2c54-4c8f-abd6-9e47ca6a7295","resolution":{"observed_at":"2026-08-15T17:45:47.582593Z","resolver_source":"doi","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T17:45:48.526497Z","title":null,"venue":null,"work_id":"c1822d6d-069a-4647-a276-8a4e0b608638","year":2020},"citing_paper":{"arxiv_id":"2507.20579","last_updated":"2025-07-28T07:27:42Z","snapshot_observed_at":"2026-08-16T17:41:52.568009Z","submitted_at":"2025-07-28T07:27:42Z","title":"AV-Deepfake1M++: A Large-Scale Audio-Visual Deepfake Benchmark with Real-World Perturbations","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-15T17:45:47.410099Z"},"links":{"citing_paper":"/paper/2507.20579"},"observation_digest":"sha256:7b6930763ca1365d567317a90d83d239447c2da570565444b4e98258df4f9b33","observation_id":"c39c0baf-a32a-4b93-95cc-4a59ebea448d","resolution":{"observed_at":"2026-08-15T17:45:48.530409Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T17:45:48.538692Z","title":"Weiss, Quan Wang, Jonathan Shen, Fei Ren, Zhifeng Chen, Patrick Nguyen, Ruoming Pang, Ignacio Lopez Moreno, and Yonghui Wu","venue":null,"work_id":"be14ddf3-f608-425f-86ae-21d2270ea2a0","year":2018},"citing_paper":{"arxiv_id":"2507.20579","last_updated":"2025-07-28T07:27:42Z","snapshot_observed_at":"2026-08-16T17:41:52.568009Z","submitted_at":"2025-07-28T07:27:42Z","title":"AV-Deepfake1M++: A Large-Scale Audio-Visual Deepfake Benchmark with Real-World Perturbations","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-15T17:45:47.405866Z"},"links":{"citing_paper":"/paper/2507.20579"},"observation_digest":"sha256:42819589ca39997d80e39308eb60694bf48dcd40c87b38c76bbedbef177502be","observation_id":"bc09b1dc-ed00-4a4e-a19e-baf6424ecc90","resolution":{"observed_at":"2026-08-15T17:45:48.543228Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T17:45:48.505999Z","title":null,"venue":null,"work_id":"fd3bbaa3-60eb-416f-b3a3-78208fdcab8b","year":2021},"citing_paper":{"arxiv_id":"2507.20579","last_updated":"2025-07-28T07:27:42Z","snapshot_observed_at":"2026-08-16T17:41:52.568009Z","submitted_at":"2025-07-28T07:27:42Z","title":"AV-Deepfake1M++: A Large-Scale Audio-Visual Deepfake Benchmark with Real-World Perturbations","version":1},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-15T17:45:47.417564Z"},"links":{"citing_paper":"/paper/2507.20579"},"observation_digest":"sha256:2762e8ea25a219c7d095aae6b9185432eb1e02d5b38bae7ff43a8215fd8756bf","observation_id":"130ad4ed-6a17-4b30-bc5e-7c798afd7a75","resolution":{"observed_at":"2026-08-15T17:45:48.509523Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T17:45:48.516178Z","title":null,"venue":null,"work_id":"d5977855-6f17-4ea1-9cf2-b31943f1ba1e","year":2021},"citing_paper":{"arxiv_id":"2507.20579","last_updated":"2025-07-28T07:27:42Z","snapshot_observed_at":"2026-08-16T17:41:52.568009Z","submitted_at":"2025-07-28T07:27:42Z","title":"AV-Deepfake1M++: A Large-Scale Audio-Visual Deepfake Benchmark with Real-World Perturbations","version":1},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-15T17:45:47.413607Z"},"links":{"citing_paper":"/paper/2507.20579"},"observation_digest":"sha256:d75ef120d00b6bd6c5dab40fa266c0a3c16192b7c6b2c4fc5dd3bba9eadf76a1","observation_id":"82d5a43e-33c2-4de5-acfd-8a9729d78a06","resolution":{"observed_at":"2026-08-15T17:45:48.519688Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2505.22581","last_updated":"2025-05-28T16:54:36Z","snapshot_observed_at":"2026-08-13T17:41:13.055021Z","submitted_at":"2025-05-28T16:54:36Z","title":"Tell me Habibi, is it Real or Fake?","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2505.22581","snapshot_observed_at":"2026-08-15T17:45:47.424822Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2507.20579","last_updated":"2025-07-28T07:27:42Z","snapshot_observed_at":"2026-08-16T17:41:52.568009Z","submitted_at":"2025-07-28T07:27:42Z","title":"AV-Deepfake1M++: A Large-Scale Audio-Visual Deepfake Benchmark with Real-World Perturbations","version":1},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-15T17:45:47.424822Z"},"links":{"cited_paper":"/paper/2505.22581","citing_paper":"/paper/2507.20579"},"observation_digest":"sha256:afb672fa4388415d59421ef8ce94f6df7bcb90aef504bc826ad14ce69cbe25c8","observation_id":"33939d5a-b4b7-4bc1-8af7-8ba78f40a7a8","resolution":{"observed_at":"2026-08-15T17:45:47.424822Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1812.08685","last_updated":"2018-12-20T16:36:39Z","snapshot_observed_at":"2026-08-14T17:40:24.206134Z","submitted_at":"2018-12-20T16:36:39Z","title":"DeepFakes: a New Threat to Face Recognition? Assessment and Detection","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1812.08685","snapshot_observed_at":"2026-08-15T17:45:47.421073Z","title":null,"venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2507.20579","last_updated":"2025-07-28T07:27:42Z","snapshot_observed_at":"2026-08-16T17:41:52.568009Z","submitted_at":"2025-07-28T07:27:42Z","title":"AV-Deepfake1M++: A Large-Scale Audio-Visual Deepfake Benchmark with Real-World Perturbations","version":1},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-15T17:45:47.421073Z"},"links":{"cited_paper":"/paper/1812.08685","citing_paper":"/paper/2507.20579"},"observation_digest":"sha256:4ba9ed1bbddd22157782e3b30bcf50b65989082a879a63dc4d7357e1317d9087","observation_id":"d669d793-acf1-4142-a9fd-ed813e15c770","resolution":{"observed_at":"2026-08-15T17:45:47.421073Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2412.09262","last_updated":"2025-03-13T09:17:52Z","snapshot_observed_at":"2026-08-16T20:23:00.161927Z","submitted_at":"2024-12-12T13:20:52Z","title":"LatentSync: Taming Audio-Conditioned Latent Diffusion Models for Lip Sync with SyncNet Supervision","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2412.09262","snapshot_observed_at":"2026-08-15T17:45:47.432412Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2507.20579","last_updated":"2025-07-28T07:27:42Z","snapshot_observed_at":"2026-08-16T17:41:52.568009Z","submitted_at":"2025-07-28T07:27:42Z","title":"AV-Deepfake1M++: A Large-Scale Audio-Visual Deepfake Benchmark with Real-World Perturbations","version":1},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-15T17:45:47.432412Z"},"links":{"cited_paper":"/paper/2412.09262","citing_paper":"/paper/2507.20579"},"observation_digest":"sha256:a84acacf8765467e5aaa2fb0bdfb4b30eb356cf14cb756e7ec221c6b18080256","observation_id":"060c05c4-3b83-466b-a851-995dd7afa734","resolution":{"observed_at":"2026-08-15T17:45:47.432412Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T17:45:48.495234Z","title":null,"venue":null,"work_id":"6216c881-53b1-4e6c-812d-02ddfdd6f5ee","year":2021},"citing_paper":{"arxiv_id":"2507.20579","last_updated":"2025-07-28T07:27:42Z","snapshot_observed_at":"2026-08-16T17:41:52.568009Z","submitted_at":"2025-07-28T07:27:42Z","title":"AV-Deepfake1M++: A Large-Scale Audio-Visual Deepfake Benchmark with Real-World Perturbations","version":1},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-08-15T17:45:47.428835Z"},"links":{"citing_paper":"/paper/2507.20579"},"observation_digest":"sha256:a61afdcce0f5966af1ba604b95f34e6e1c831a0230c21d6aa39ed89addfeea56","observation_id":"a8a33e75-3e00-4062-9c22-354cd04ccb0b","resolution":{"observed_at":"2026-08-15T17:45:48.499311Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T17:45:47.440458Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2507.20579","last_updated":"2025-07-28T07:27:42Z","snapshot_observed_at":"2026-08-16T17:41:52.568009Z","submitted_at":"2025-07-28T07:27:42Z","title":"AV-Deepfake1M++: A Large-Scale Audio-Visual Deepfake Benchmark with Real-World Perturbations","version":1},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-08-15T17:45:47.440458Z"},"links":{"citing_paper":"/paper/2507.20579"},"observation_digest":"sha256:fd9ad89d29c9bd1aa08a4624d7e4eb870eff6c06f7c927322bec93f717f43782","observation_id":"005d79b4-63bd-49be-b6ca-a26185a80696","resolution":{"observed_at":"2026-08-15T17:45:47.440458Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T17:45:48.484720Z","title":null,"venue":null,"work_id":"1df19d8d-60d7-4f66-af70-677b7beda606","year":2020},"citing_paper":{"arxiv_id":"2507.20579","last_updated":"2025-07-28T07:27:42Z","snapshot_observed_at":"2026-08-16T17:41:52.568009Z","submitted_at":"2025-07-28T07:27:42Z","title":"AV-Deepfake1M++: A Large-Scale Audio-Visual Deepfake Benchmark with Real-World Perturbations","version":1},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-08-15T17:45:47.436755Z"},"links":{"citing_paper":"/paper/2507.20579"},"observation_digest":"sha256:c50b75ece6060aeaa2d6e49c0e868119a613c89c6ff21dd231889f5031df0275","observation_id":"075081da-a2bf-4488-be13-e4184424e2b6","resolution":{"observed_at":"2026-08-15T17:45:48.488434Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2507.10066","last_updated":"2025-08-12T14:34:03Z","snapshot_observed_at":"2026-08-15T18:59:06.153826Z","submitted_at":"2025-07-14T08:52:03Z","title":"LayLens: Improving Deepfake Understanding through Simplified Explanations","version":2},"cited_work":{"arxiv_id":"2507.10066","doi":null,"metadata_source":"pith","pith_arxiv_id":"2507.10066","snapshot_observed_at":"2026-08-15T17:45:48.034929Z","title":"LayLens: Improving Deepfake Understanding through Simplified Explanations","venue":"cs.MM","work_id":"8d6ef25c-f1a2-481b-b69f-41b5f06cc381","year":2025},"citing_paper":{"arxiv_id":"2507.20579","last_updated":"2025-07-28T07:27:42Z","snapshot_observed_at":"2026-08-16T17:41:52.568009Z","submitted_at":"2025-07-28T07:27:42Z","title":"AV-Deepfake1M++: A Large-Scale Audio-Visual Deepfake Benchmark with Real-World Perturbations","version":1},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-08-15T17:45:47.451146Z"},"links":{"cited_paper":"/paper/2507.10066","citing_paper":"/paper/2507.20579"},"observation_digest":"sha256:e6c8955da2411e9182b525f5a29e36b3664b6ddb4aa5478ea9109af7c37f086d","observation_id":"9264e8cb-7c62-4f41-85bb-f0db6f2a8d51","resolution":{"observed_at":"2026-08-15T17:45:48.039758Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T17:45:47.443735Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2507.20579","last_updated":"2025-07-28T07:27:42Z","snapshot_observed_at":"2026-08-16T17:41:52.568009Z","submitted_at":"2025-07-28T07:27:42Z","title":"AV-Deepfake1M++: A Large-Scale Audio-Visual Deepfake Benchmark with Real-World Perturbations","version":1},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-08-15T17:45:47.443735Z"},"links":{"citing_paper":"/paper/2507.20579"},"observation_digest":"sha256:807f8db4e10b22b95e4651fcdeee455897448123fe7167e50d6bde1f6968519f","observation_id":"7014acd9-b107-4225-9ef0-8a76761c5adc","resolution":{"observed_at":"2026-08-15T17:45:47.443735Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T17:45:48.442252Z","title":null,"venue":null,"work_id":"a757f6a7-a7b4-457b-97d3-fe2a004cf367","year":2019},"citing_paper":{"arxiv_id":"2507.20579","last_updated":"2025-07-28T07:27:42Z","snapshot_observed_at":"2026-08-16T17:41:52.568009Z","submitted_at":"2025-07-28T07:27:42Z","title":"AV-Deepfake1M++: A Large-Scale Audio-Visual Deepfake Benchmark with Real-World Perturbations","version":1},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-08-15T17:45:47.459176Z"},"links":{"citing_paper":"/paper/2507.20579"},"observation_digest":"sha256:69d60c1dc39454997186d93eb941ec7c8f828e08a2327ccb63eb2c71afa73973","observation_id":"688a9413-8458-4b7e-ac35-25ed1678794e","resolution":{"observed_at":"2026-08-15T17:45:48.446298Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2410.21276","last_updated":"2024-10-25T17:43:01Z","snapshot_observed_at":"2026-08-15T14:02:47.366139Z","submitted_at":"2024-10-25T17:43:01Z","title":"GPT-4o System Card","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2410.21276","snapshot_observed_at":"2026-08-15T17:45:47.463111Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.20579","last_updated":"2025-07-28T07:27:42Z","snapshot_observed_at":"2026-08-16T17:41:52.568009Z","submitted_at":"2025-07-28T07:27:42Z","title":"AV-Deepfake1M++: A Large-Scale Audio-Visual Deepfake Benchmark with Real-World Perturbations","version":1},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-08-15T17:45:47.463111Z"},"links":{"cited_paper":"/paper/2410.21276","citing_paper":"/paper/2507.20579"},"observation_digest":"sha256:9becf3e5be0ffb822e01322b9674c5c0f5b5431545107275180d1347b2f333fb","observation_id":"7752483d-1340-44a0-aa1f-09352f0717b8","resolution":{"observed_at":"2026-08-15T17:45:47.463111Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T17:45:48.455041Z","title":null,"venue":null,"work_id":"2a9d5079-abfd-4b83-82c8-c223eecf0204","year":2023},"citing_paper":{"arxiv_id":"2507.20579","last_updated":"2025-07-28T07:27:42Z","snapshot_observed_at":"2026-08-16T17:41:52.568009Z","submitted_at":"2025-07-28T07:27:42Z","title":"AV-Deepfake1M++: A Large-Scale Audio-Visual Deepfake Benchmark with Real-World Perturbations","version":1},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-08-15T17:45:47.455252Z"},"links":{"citing_paper":"/paper/2507.20579"},"observation_digest":"sha256:856b9a1d65722fd6679b983fd800e8f7b11a3cd1f976b27d8f5a77449229d10d","observation_id":"aee80d79-35be-4f34-885d-009507fa1bc9","resolution":{"observed_at":"2026-08-15T17:45:48.458681Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T17:45:48.419006Z","title":null,"venue":null,"work_id":"57616528-6790-43ca-b805-d6a92c6f0b1e","year":2024},"citing_paper":{"arxiv_id":"2507.20579","last_updated":"2025-07-28T07:27:42Z","snapshot_observed_at":"2026-08-16T17:41:52.568009Z","submitted_at":"2025-07-28T07:27:42Z","title":"AV-Deepfake1M++: A Large-Scale Audio-Visual Deepfake Benchmark with Real-World Perturbations","version":1},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-08-15T17:45:47.477612Z"},"links":{"citing_paper":"/paper/2507.20579"},"observation_digest":"sha256:0e3c24b4bffd4be2ac2c62c357a0a9c4aa211ff062de680317697046a0eb8db0","observation_id":"309118af-2e6e-42c7-b2c4-be4f30d729df","resolution":{"observed_at":"2026-08-15T17:45:48.422806Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T17:45:47.481049Z","title":"Namboodiri, and C.V","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2507.20579","last_updated":"2025-07-28T07:27:42Z","snapshot_observed_at":"2026-08-16T17:41:52.568009Z","submitted_at":"2025-07-28T07:27:42Z","title":"AV-Deepfake1M++: A Large-Scale Audio-Visual Deepfake Benchmark with Real-World Perturbations","version":1},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-08-15T17:45:47.481049Z"},"links":{"citing_paper":"/paper/2507.20579"},"observation_digest":"sha256:1b1429d222d79669c290ed490a51681ac0cb3818105216987d1dee228c2cd553","observation_id":"446518ea-4f48-4e24-a5f3-ee356f121149","resolution":{"observed_at":"2026-08-15T17:45:47.481049Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T17:45:48.430630Z","title":"Christiano, Jan Leike, and Ryan Lowe","venue":null,"work_id":"0520b41a-92bc-4024-8cab-88919cee74b2","year":2022},"citing_paper":{"arxiv_id":"2507.20579","last_updated":"2025-07-28T07:27:42Z","snapshot_observed_at":"2026-08-16T17:41:52.568009Z","submitted_at":"2025-07-28T07:27:42Z","title":"AV-Deepfake1M++: A Large-Scale Audio-Visual Deepfake Benchmark with Real-World Perturbations","version":1},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-08-15T17:45:47.473120Z"},"links":{"citing_paper":"/paper/2507.20579"},"observation_digest":"sha256:35d12e293032831d8bb385b2514bce47090580ee3a6b6878f8c698545fae25af","observation_id":"c61f2155-e5a5-4da8-9ef5-3d5ddd4cb4e0","resolution":{"observed_at":"2026-08-15T17:45:48.434518Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T17:45:48.400061Z","title":null,"venue":null,"work_id":"f551cf6e-2b89-40cb-b47c-1db0b73215fe","year":2019},"citing_paper":{"arxiv_id":"2507.20579","last_updated":"2025-07-28T07:27:42Z","snapshot_observed_at":"2026-08-16T17:41:52.568009Z","submitted_at":"2025-07-28T07:27:42Z","title":"AV-Deepfake1M++: A Large-Scale Audio-Visual Deepfake Benchmark with Real-World Perturbations","version":1},"reference_index":36,"source":"pdf_text","source_observed_at":"2026-08-15T17:45:47.491111Z"},"links":{"citing_paper":"/paper/2507.20579"},"observation_digest":"sha256:e3dcb72923a9cb4160bc0c427a954dccee88c6696aee7958f55ac8669c2e1c6d","observation_id":"c70bc5e6-23ce-49cd-88d2-cfb1a455746b","resolution":{"observed_at":"2026-08-15T17:45:48.404974Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T17:45:47.494486Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2507.20579","last_updated":"2025-07-28T07:27:42Z","snapshot_observed_at":"2026-08-16T17:41:52.568009Z","submitted_at":"2025-07-28T07:27:42Z","title":"AV-Deepfake1M++: A Large-Scale Audio-Visual Deepfake Benchmark with Real-World Perturbations","version":1},"reference_index":37,"source":"pdf_text","source_observed_at":"2026-08-15T17:45:47.494486Z"},"links":{"citing_paper":"/paper/2507.20579"},"observation_digest":"sha256:c6c268ff160e4e966ccc3073006cd85daba0497d68d8870029602193f5063c9a","observation_id":"a45d9cc9-d678-4e74-8e70-684d52db9f20","resolution":{"observed_at":"2026-08-15T17:45:47.494486Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T17:45:48.389347Z","title":null,"venue":null,"work_id":"30a7d169-4dcf-4e2f-8eee-3342659eeeb0","year":2024},"citing_paper":{"arxiv_id":"2507.20579","last_updated":"2025-07-28T07:27:42Z","snapshot_observed_at":"2026-08-16T17:41:52.568009Z","submitted_at":"2025-07-28T07:27:42Z","title":"AV-Deepfake1M++: A Large-Scale Audio-Visual Deepfake Benchmark with Real-World Perturbations","version":1},"reference_index":38,"source":"pdf_text","source_observed_at":"2026-08-15T17:45:47.498085Z"},"links":{"citing_paper":"/paper/2507.20579"},"observation_digest":"sha256:22dc4463c6fcc5f1ca98e5b9925010fefafdd5b84edbf90c097e757c515b4285","observation_id":"a2ca4199-cbcf-4116-90ab-3c729a3c1b14","resolution":{"observed_at":"2026-08-15T17:45:48.393055Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T17:45:47.509457Z","title":null,"venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2507.20579","last_updated":"2025-07-28T07:27:42Z","snapshot_observed_at":"2026-08-16T17:41:52.568009Z","submitted_at":"2025-07-28T07:27:42Z","title":"AV-Deepfake1M++: A Large-Scale Audio-Visual Deepfake Benchmark with Real-World Perturbations","version":1},"reference_index":41,"source":"pdf_text","source_observed_at":"2026-08-15T17:45:47.509457Z"},"links":{"citing_paper":"/paper/2507.20579"},"observation_digest":"sha256:e534b40e27954c8126359f925877e0fe196dcfb63193f670f872a70ad5fe46de","observation_id":"a767b8d9-6995-4ef0-a6b0-10759efa8589","resolution":{"observed_at":"2026-08-15T17:45:47.509457Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T17:45:47.512644Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.20579","last_updated":"2025-07-28T07:27:42Z","snapshot_observed_at":"2026-08-16T17:41:52.568009Z","submitted_at":"2025-07-28T07:27:42Z","title":"AV-Deepfake1M++: A Large-Scale Audio-Visual Deepfake Benchmark with Real-World Perturbations","version":1},"reference_index":42,"source":"pdf_text","source_observed_at":"2026-08-15T17:45:47.512644Z"},"links":{"citing_paper":"/paper/2507.20579"},"observation_digest":"sha256:9801e22d4f84684ed4817215355ab247784af2d5ef65a2d62ab64b3b720d132e","observation_id":"fd76e920-b32d-48fa-9e2d-52c5317f046d","resolution":{"observed_at":"2026-08-15T17:45:47.512644Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T17:45:48.378826Z","title":"Tan, and Haizhou Li","venue":null,"work_id":"6a62a700-891b-4a2f-b9c7-56ff8b89730b","year":2023},"citing_paper":{"arxiv_id":"2507.20579","last_updated":"2025-07-28T07:27:42Z","snapshot_observed_at":"2026-08-16T17:41:52.568009Z","submitted_at":"2025-07-28T07:27:42Z","title":"AV-Deepfake1M++: A Large-Scale Audio-Visual Deepfake Benchmark with Real-World Perturbations","version":1},"reference_index":43,"source":"pdf_text","source_observed_at":"2026-08-15T17:45:47.501647Z"},"links":{"citing_paper":"/paper/2507.20579"},"observation_digest":"sha256:389cd981c7b7eabfa262c3eaa20cd635ac6a359c9e06786d1c7f0ec4428094e7","observation_id":"855730a8-ac95-4cef-8fec-b12f8b7c6969","resolution":{"observed_at":"2026-08-15T17:45:48.382261Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T17:45:47.519404Z","title":null,"venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2507.20579","last_updated":"2025-07-28T07:27:42Z","snapshot_observed_at":"2026-08-16T17:41:52.568009Z","submitted_at":"2025-07-28T07:27:42Z","title":"AV-Deepfake1M++: A Large-Scale Audio-Visual Deepfake Benchmark with Real-World Perturbations","version":1},"reference_index":44,"source":"pdf_text","source_observed_at":"2026-08-15T17:45:47.519404Z"},"links":{"citing_paper":"/paper/2507.20579"},"observation_digest":"sha256:745f5bc19a9c2bd80422c2b9b619029a5003bb03809d0b89d6fdee50484d700a","observation_id":"400ebb5f-4e72-492f-897f-543f887b0e24","resolution":{"observed_at":"2026-08-15T17:45:47.519404Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T17:45:47.523057Z","title":"Zingarini, D","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.20579","last_updated":"2025-07-28T07:27:42Z","snapshot_observed_at":"2026-08-16T17:41:52.568009Z","submitted_at":"2025-07-28T07:27:42Z","title":"AV-Deepfake1M++: A Large-Scale Audio-Visual Deepfake Benchmark with Real-World Perturbations","version":1},"reference_index":45,"source":"pdf_text","source_observed_at":"2026-08-15T17:45:47.523057Z"},"links":{"citing_paper":"/paper/2507.20579"},"observation_digest":"sha256:8c092f40f991f43459d470ac00263d8468befc7aa79eaff42109e6c8096ba87e","observation_id":"ab4fc3b2-b361-4be9-99bc-4756602e9407","resolution":{"observed_at":"2026-08-15T17:45:47.523057Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T17:45:48.367607Z","title":null,"venue":null,"work_id":"59e21509-7983-4dc9-9224-96f96a335dcc","year":2021},"citing_paper":{"arxiv_id":"2507.20579","last_updated":"2025-07-28T07:27:42Z","snapshot_observed_at":"2026-08-16T17:41:52.568009Z","submitted_at":"2025-07-28T07:27:42Z","title":"AV-Deepfake1M++: A Large-Scale Audio-Visual Deepfake Benchmark with Real-World Perturbations","version":1},"reference_index":47,"source":"pdf_text","source_observed_at":"2026-08-15T17:45:47.515852Z"},"links":{"citing_paper":"/paper/2507.20579"},"observation_digest":"sha256:6fac624f929a1407956d65b65f01eb87a425bef80612ba563bae8cb93703f416","observation_id":"ce462c9a-4122-4d7a-9603-5cf84e9e32f3","resolution":{"observed_at":"2026-08-15T17:45:48.371385Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T17:45:47.484450Z","title":"In Proceedings of the 28th ACM International Conference on Multimedia (MM ’20)","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2507.20579","last_updated":"2025-07-28T07:27:42Z","snapshot_observed_at":"2026-08-16T17:41:52.568009Z","submitted_at":"2025-07-28T07:27:42Z","title":"AV-Deepfake1M++: A Large-Scale Audio-Visual Deepfake Benchmark with Real-World Perturbations","version":1},"reference_index":2020,"source":"pdf_text","source_observed_at":"2026-08-15T17:45:47.484450Z"},"links":{"citing_paper":"/paper/2507.20579"},"observation_digest":"sha256:8d73fc740ac881cb4b55012080e2ccf5dcedfe7bd2cd304a77dbd4dec2af3c24","observation_id":"eef2ad70-d171-43d0-a4f1-5f76e32f5897","resolution":{"observed_at":"2026-08-15T17:45:47.484450Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T17:45:48.466045Z","title":"In Proceedings of the IEEE/CVF Winter Conference on Applications of Computer Vision","venue":null,"work_id":"4af51aa4-5b8b-47ab-8c8a-7eaba4ea0523","year":null},"citing_paper":{"arxiv_id":"2507.20579","last_updated":"2025-07-28T07:27:42Z","snapshot_observed_at":"2026-08-16T17:41:52.568009Z","submitted_at":"2025-07-28T07:27:42Z","title":"AV-Deepfake1M++: A Large-Scale Audio-Visual Deepfake Benchmark with Real-World Perturbations","version":1},"reference_index":2024,"source":"pdf_text","source_observed_at":"2026-08-15T17:45:47.447206Z"},"links":{"citing_paper":"/paper/2507.20579"},"observation_digest":"sha256:d495b91fba6521ef44074c98fc4fc1c3b022be0ae7bcbb744b7b0c3504eefe91","observation_id":"72c078f9-8e8c-49ff-a4d5-e68d254cf69d","resolution":{"observed_at":"2026-08-15T17:45:48.470498Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2506.00868","last_updated":"2025-06-16T12:09:09Z","snapshot_observed_at":"2026-08-14T18:13:04.293093Z","submitted_at":"2025-06-01T07:17:16Z","title":"Multiverse Through Deepfakes: The MultiFakeVerse Dataset of Person-Centric Visual and Conceptual Manipulations","version":2},"cited_work":{"arxiv_id":"2506.00868","doi":"10.48550/arxiv.2506.00868","metadata_source":"pith","pith_arxiv_id":"2506.00868","snapshot_observed_at":"2026-08-15T18:16:14.067578Z","title":"Multiverse Through Deepfakes: The MultiFakeVerse Dataset of Person-Centric Visual and Conceptual Manipulations","venue":"cs.MM","work_id":"d993cb58-9600-410b-abb1-c79a86b490dc","year":2025},"citing_paper":{"arxiv_id":"2507.20579","last_updated":"2025-07-28T07:27:42Z","snapshot_observed_at":"2026-08-16T17:41:52.568009Z","submitted_at":"2025-07-28T07:27:42Z","title":"AV-Deepfake1M++: A Large-Scale Audio-Visual Deepfake Benchmark with Real-World Perturbations","version":1},"reference_index":2025,"source":"pdf_text","source_observed_at":"2026-08-15T17:45:47.385102Z"},"links":{"cited_paper":"/paper/2506.00868","citing_paper":"/paper/2507.20579"},"observation_digest":"sha256:21d810db08f85b549eef2443e1dca51fada22c69a1c6788cc2d1fdd856b08027","observation_id":"95daa3ce-fb31-4a7f-8da9-9c3ce556c67c","resolution":{"observed_at":"2026-08-15T17:45:47.600252Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}}],"paper":{"arxiv_id":"2507.20579","last_updated":"2025-07-28T07:27:42Z","latest_version":1,"primary_category":"cs.CV","snapshot_observed_at":"2026-08-16T17:41:52.568009Z","submitted_at":"2025-07-28T07:27:42Z","title":"AV-Deepfake1M++: A Large-Scale Audio-Visual Deepfake Benchmark with Real-World Perturbations"},"reference_resolution":{"displayed":47,"state_counts":{"malformed_identifier":1,"metadata_mismatch":1,"parse_uncertain":0,"unresolved":38,"verified_exact":2,"verified_fuzzy":5},"total_outbound_references":47},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"thesis":"As of 17 August 2026, this Paper Citation Record lists 47 of 47 outbound references and 2 inbound Pith citation observations for arXiv:2507.20579."}