{"as_of":"2026-08-21T21:39:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:d12608faba9421a6b183edb4f758da82f7aac69ca22556b5950be0f1e16c9109","coverage":[{"denominator":52,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":52,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-06T20:50:16.986076Z","state":"measured"},{"denominator":52,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":52,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-21T06:32:19.484+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2507.01750/citation-record","integrity":"/paper/2507.01750/integrity","json":"/paper/2507.01750/citation-record.json","paper":"/paper/2507.01750"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T20:50:23.258293Z","title":"Fbi warns of increasing threat of cyber criminals utilizing artificial intelligence,","venue":null,"work_id":"53154680-1021-4586-8375-39fe69436b71","year":2025},"citing_paper":{"arxiv_id":"2507.01750","last_updated":"2025-07-02T14:28:11Z","snapshot_observed_at":"2026-08-20T07:27:39.514940Z","submitted_at":"2025-07-02T14:28:11Z","title":"Generalizable Detection of Audio Deepfakes","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-06T20:50:16.745745Z"},"links":{"citing_paper":"/paper/2507.01750"},"observation_digest":"sha256:fd8f2429c4836c96b0cda2985756ec4b5c31d79ed93d35def185546d236da351","observation_id":"0f70488c-eea8-41a3-8603-efa08e58d0a6","resolution":{"observed_at":"2026-08-06T20:50:23.339001Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T20:50:23.122015Z","title":"Pay-to-play: Access to justice in the era of ai and deep- fakes,","venue":null,"work_id":"38f2406e-0c22-4cf4-a1e4-5153fb910c93","year":2025},"citing_paper":{"arxiv_id":"2507.01750","last_updated":"2025-07-02T14:28:11Z","snapshot_observed_at":"2026-08-20T07:27:39.514940Z","submitted_at":"2025-07-02T14:28:11Z","title":"Generalizable Detection of Audio Deepfakes","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-06T20:50:16.751337Z"},"links":{"citing_paper":"/paper/2507.01750"},"observation_digest":"sha256:e192ab8ef69a18b8135642b1f6eec8fbac3294b4a9c96b04ca225728fa11839e","observation_id":"32025b7f-36f3-4268-aea7-dd5cce59e3e7","resolution":{"observed_at":"2026-08-06T20:50:23.191862Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T20:50:23.012383Z","title":"Asvspoof 2015: the first automatic speaker verification spoofing and countermeasures challenge,","venue":null,"work_id":"cdb5946f-af07-4b59-8f26-796e971783f4","year":2015},"citing_paper":{"arxiv_id":"2507.01750","last_updated":"2025-07-02T14:28:11Z","snapshot_observed_at":"2026-08-20T07:27:39.514940Z","submitted_at":"2025-07-02T14:28:11Z","title":"Generalizable Detection of Audio Deepfakes","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-06T20:50:16.755997Z"},"links":{"citing_paper":"/paper/2507.01750"},"observation_digest":"sha256:e7f92487977c3e8e43e3f4ebf632d9b98125b7f0b780c3199d0195d75d66b565","observation_id":"06479550-9fef-4425-8dc8-18f2993a67e3","resolution":{"observed_at":"2026-08-06T20:50:23.068828Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T20:50:22.884276Z","title":"Automatic speaker verification spoofing and countermeasures challenge (asvspoof 2015) database,","venue":null,"work_id":"d4e9e2b1-82d6-434e-83b5-0b1a8802393e","year":2015},"citing_paper":{"arxiv_id":"2507.01750","last_updated":"2025-07-02T14:28:11Z","snapshot_observed_at":"2026-08-20T07:27:39.514940Z","submitted_at":"2025-07-02T14:28:11Z","title":"Generalizable Detection of Audio Deepfakes","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-06T20:50:16.760586Z"},"links":{"citing_paper":"/paper/2507.01750"},"observation_digest":"sha256:fb6bc19c5dcd486330f4b12fea20258bd253d0518c022cc9472dfc887f7a0ee2","observation_id":"b3b5ad94-bff8-41a4-a49c-4e0e762322ff","resolution":{"observed_at":"2026-08-06T20:50:22.945158Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T20:50:22.741129Z","title":"The asvspoof 2017 challenge: Assessing the limits of replay spoofing attack detection,","venue":null,"work_id":"8169cb07-37de-4d3e-89d4-9150f4c07349","year":2017},"citing_paper":{"arxiv_id":"2507.01750","last_updated":"2025-07-02T14:28:11Z","snapshot_observed_at":"2026-08-20T07:27:39.514940Z","submitted_at":"2025-07-02T14:28:11Z","title":"Generalizable Detection of Audio Deepfakes","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-06T20:50:16.765295Z"},"links":{"citing_paper":"/paper/2507.01750"},"observation_digest":"sha256:64c8d558dd18f2a273350af2e100ce27826bd3972cba46427ae7c4d6981c7b35","observation_id":"8c0cd200-f89f-4568-bb40-e7f9a542a1ef","resolution":{"observed_at":"2026-08-06T20:50:22.801167Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T20:50:22.627922Z","title":"The 2nd automatic speaker verification spoofing and countermeasures challenge (asvspoof 2017) database, version 2,","venue":null,"work_id":"5d05d27d-6da8-4594-a47d-f6c97c21c8cc","year":2017},"citing_paper":{"arxiv_id":"2507.01750","last_updated":"2025-07-02T14:28:11Z","snapshot_observed_at":"2026-08-20T07:27:39.514940Z","submitted_at":"2025-07-02T14:28:11Z","title":"Generalizable Detection of Audio Deepfakes","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-06T20:50:16.769857Z"},"links":{"citing_paper":"/paper/2507.01750"},"observation_digest":"sha256:6a493f4cd4afc2c16b62ed7a5d009e0ef25f9f751462ae9024bac852eb3ff610","observation_id":"74beae96-f75d-46c1-bf98-92d158a7263b","resolution":{"observed_at":"2026-08-06T20:50:22.663959Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T20:50:22.477882Z","title":"ASVspoof 2019: Future Horizons in Spoofed and Fake Audio Detection,","venue":null,"work_id":"824882a5-33d3-452f-8d4e-d3946e6c9f66","year":2019},"citing_paper":{"arxiv_id":"2507.01750","last_updated":"2025-07-02T14:28:11Z","snapshot_observed_at":"2026-08-20T07:27:39.514940Z","submitted_at":"2025-07-02T14:28:11Z","title":"Generalizable Detection of Audio Deepfakes","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-06T20:50:16.774669Z"},"links":{"citing_paper":"/paper/2507.01750"},"observation_digest":"sha256:24afcd4db944512761b1569e81de0eb8231354a5906a7ae572595ed719523be2","observation_id":"3c1c70d2-1b4f-4932-ac52-94d6914b7abb","resolution":{"observed_at":"2026-08-06T20:50:22.504721Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T20:50:22.347601Z","title":"Asvspoof 2019: The 3rd automatic speaker verification spoofing and countermeasures challenge database,","venue":null,"work_id":"277ad20d-d3f2-4225-8c79-94de24e1bf4d","year":2019},"citing_paper":{"arxiv_id":"2507.01750","last_updated":"2025-07-02T14:28:11Z","snapshot_observed_at":"2026-08-20T07:27:39.514940Z","submitted_at":"2025-07-02T14:28:11Z","title":"Generalizable Detection of Audio Deepfakes","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-06T20:50:16.778982Z"},"links":{"citing_paper":"/paper/2507.01750"},"observation_digest":"sha256:512bd2e9567dcd458135e21353579d7795d1614c5b1e821f7ab72fab9b440a54","observation_id":"42690f01-465a-434d-b1fc-7b49ed2b773e","resolution":{"observed_at":"2026-08-06T20:50:22.391927Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2210.02437","last_updated":"2023-06-22T13:00:56Z","snapshot_observed_at":"2026-08-18T03:35:46.822125Z","submitted_at":"2022-10-05T17:57:29Z","title":"ASVspoof 2021: Towards Spoofed and Deepfake Speech Detection in the Wild","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2210.02437","snapshot_observed_at":"2026-08-06T20:50:16.783557Z","title":"ASVspoof 2021: Towards Spoofed and Deepfake Speech Detection in the Wild,","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2507.01750","last_updated":"2025-07-02T14:28:11Z","snapshot_observed_at":"2026-08-20T07:27:39.514940Z","submitted_at":"2025-07-02T14:28:11Z","title":"Generalizable Detection of Audio Deepfakes","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-06T20:50:16.783557Z"},"links":{"cited_paper":"/paper/2210.02437","citing_paper":"/paper/2507.01750"},"observation_digest":"sha256:293774eff4286b6b06cd63713fe29ae675930f9cade0905f806c3fbc274a8214","observation_id":"9e350314-1a0c-4a9c-9428-0e6585f295ff","resolution":{"observed_at":"2026-08-06T20:50:16.783557Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"record/4837263","doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T20:50:17.316249Z","title":"Asvspoof 2021 challenge - logical access database,","venue":null,"work_id":"b0724a82-4413-4c79-95e5-7dfe163cc080","year":2021},"citing_paper":{"arxiv_id":"2507.01750","last_updated":"2025-07-02T14:28:11Z","snapshot_observed_at":"2026-08-20T07:27:39.514940Z","submitted_at":"2025-07-02T14:28:11Z","title":"Generalizable Detection of Audio Deepfakes","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-06T20:50:16.788351Z"},"links":{"citing_paper":"/paper/2507.01750"},"observation_digest":"sha256:f717019410a131d58a00b9005e430e231aa0eb2c815d0b97cac0588de7ef4c66","observation_id":"d9741157-32ba-4216-8375-4721f9a4da9d","resolution":{"observed_at":"2026-08-06T20:50:17.331614Z","resolver_source":"raw_fallback","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"record/4834716","doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T20:50:17.232815Z","title":"Asvspoof 2021 challenge - physical access database,","venue":null,"work_id":"e8b07322-25b2-417c-95bd-8905b172cb08","year":2021},"citing_paper":{"arxiv_id":"2507.01750","last_updated":"2025-07-02T14:28:11Z","snapshot_observed_at":"2026-08-20T07:27:39.514940Z","submitted_at":"2025-07-02T14:28:11Z","title":"Generalizable Detection of Audio Deepfakes","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-06T20:50:16.792897Z"},"links":{"citing_paper":"/paper/2507.01750"},"observation_digest":"sha256:e5ca25171c8babfd89f063b2499fffc11fe3383303726f802c1bce617d8ccb58","observation_id":"df2c3136-89d4-4e8a-b647-5e4902504f2e","resolution":{"observed_at":"2026-08-06T20:50:17.240874Z","resolver_source":"raw_fallback","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"record/4835108","doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T20:50:17.153762Z","title":"Asvspoof 2021 challenge - speech deepfake database,","venue":null,"work_id":"ef578550-1d1f-4c3b-a8cb-6c5e6764dfd7","year":2021},"citing_paper":{"arxiv_id":"2507.01750","last_updated":"2025-07-02T14:28:11Z","snapshot_observed_at":"2026-08-20T07:27:39.514940Z","submitted_at":"2025-07-02T14:28:11Z","title":"Generalizable Detection of Audio Deepfakes","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-06T20:50:16.797652Z"},"links":{"citing_paper":"/paper/2507.01750"},"observation_digest":"sha256:e2602776c7f60fc2ad160b57672141cf0357f8165d7afcc502468d1e57fcdf2c","observation_id":"3314f024-a785-4c11-bc5e-663238402d9f","resolution":{"observed_at":"2026-08-06T20:50:17.163391Z","resolver_source":"raw_fallback","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2408.08739","last_updated":"2024-08-16T13:37:20Z","snapshot_observed_at":"2026-08-19T02:11:16.717807Z","submitted_at":"2024-08-16T13:37:20Z","title":"ASVspoof 5: Crowdsourced Speech Data, Deepfakes, and Adversarial Attacks at Scale","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2408.08739","snapshot_observed_at":"2026-08-06T20:50:16.802078Z","title":"Asvspoof 5: Crowdsourced speech data, deepfakes, and adversarial attacks at scale,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.01750","last_updated":"2025-07-02T14:28:11Z","snapshot_observed_at":"2026-08-20T07:27:39.514940Z","submitted_at":"2025-07-02T14:28:11Z","title":"Generalizable Detection of Audio Deepfakes","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-06T20:50:16.802078Z"},"links":{"cited_paper":"/paper/2408.08739","citing_paper":"/paper/2507.01750"},"observation_digest":"sha256:0e1c48dab513344299e9d6490422c52777ce4545c8f1790a8a720a8359dab959","observation_id":"f1fde9ea-1f3b-4407-84d4-dbff35c66b3c","resolution":{"observed_at":"2026-08-06T20:50:16.802078Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":"10.5281/zenodo.14498691","metadata_source":"openalex","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T05:30:23.456663Z","title":"Asvspoof 5: Design, collection and validation of resources for spoofing, deepfake, and adversarial attack detection using crowdsourced speech,","venue":"Zenodo (CERN European Organization for Nuclear Research)","work_id":"0aa9feba-f8cd-4bfa-b8a2-4550391afc3a","year":2024},"citing_paper":{"arxiv_id":"2507.01750","last_updated":"2025-07-02T14:28:11Z","snapshot_observed_at":"2026-08-20T07:27:39.514940Z","submitted_at":"2025-07-02T14:28:11Z","title":"Generalizable Detection of Audio Deepfakes","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-06T20:50:16.807883Z"},"links":{"citing_paper":"/paper/2507.01750"},"observation_digest":"sha256:8f78e902d431ea997a3199fc36d74854d7f6e80c061d5dcee53462aecd085406","observation_id":"d8f3e947-4b8b-42a0-909b-192a8b55a19b","resolution":{"observed_at":"2026-08-06T20:50:22.284049Z","resolver_source":"doi","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T20:50:21.983671Z","title":"Add 2022: the first audio deep synthesis detection challenge,","venue":null,"work_id":"d59b7ea2-838e-4bc5-8a70-ff782c71546e","year":2022},"citing_paper":{"arxiv_id":"2507.01750","last_updated":"2025-07-02T14:28:11Z","snapshot_observed_at":"2026-08-20T07:27:39.514940Z","submitted_at":"2025-07-02T14:28:11Z","title":"Generalizable Detection of Audio Deepfakes","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-06T20:50:16.812117Z"},"links":{"citing_paper":"/paper/2507.01750"},"observation_digest":"sha256:8582a126eddc5b49cb693173b31e8bb71f3f66169800e4ebe9f6c81217084fd8","observation_id":"c9d0aadb-3b4c-4452-b57f-9edd7744a166","resolution":{"observed_at":"2026-08-06T20:50:22.076228Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T20:50:21.826588Z","title":"Does audio deepfake detection generalize?","venue":null,"work_id":"a2cfaa6c-7098-4356-b17a-83cc5c5672be","year":2022},"citing_paper":{"arxiv_id":"2507.01750","last_updated":"2025-07-02T14:28:11Z","snapshot_observed_at":"2026-08-20T07:27:39.514940Z","submitted_at":"2025-07-02T14:28:11Z","title":"Generalizable Detection of Audio Deepfakes","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-06T20:50:16.817113Z"},"links":{"citing_paper":"/paper/2507.01750"},"observation_digest":"sha256:982e137971c6444767e47961835c45841218d2364195491e4b0a6d385f2c9618","observation_id":"d77b73d3-736b-4c1f-842e-d09e78632e18","resolution":{"observed_at":"2026-08-06T20:50:21.878283Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T20:50:21.598138Z","title":"Dataset artefacts in anti- spoofing systems: A case study on the asvspoof 2017 benchmark,","venue":null,"work_id":"4e195cdf-e2b8-4931-95a3-cc7078773fa7","year":2017},"citing_paper":{"arxiv_id":"2507.01750","last_updated":"2025-07-02T14:28:11Z","snapshot_observed_at":"2026-08-20T07:27:39.514940Z","submitted_at":"2025-07-02T14:28:11Z","title":"Generalizable Detection of Audio Deepfakes","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-06T20:50:16.821782Z"},"links":{"citing_paper":"/paper/2507.01750"},"observation_digest":"sha256:cf186564d61fb8b69f8dcff22ece23df0de72c43d5950836e4715dc9eacbf18d","observation_id":"dbf91de0-2c76-4997-ba74-baa66a3b79a8","resolution":{"observed_at":"2026-08-06T20:50:21.680081Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T20:50:21.441766Z","title":"The effect of silence and dual-band fusion in anti-spoofing system,","venue":null,"work_id":"3a232f3d-3cc9-487d-bf41-dabdb9c81d9b","year":2021},"citing_paper":{"arxiv_id":"2507.01750","last_updated":"2025-07-02T14:28:11Z","snapshot_observed_at":"2026-08-20T07:27:39.514940Z","submitted_at":"2025-07-02T14:28:11Z","title":"Generalizable Detection of Audio Deepfakes","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-06T20:50:16.827105Z"},"links":{"citing_paper":"/paper/2507.01750"},"observation_digest":"sha256:00818441e304b40ca87054af98ae1620ed9332d476ad8500d57a9cd1d59b2279","observation_id":"8d115779-de40-45f2-a941-38f1889364d2","resolution":{"observed_at":"2026-08-06T20:50:21.497630Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T20:50:21.102558Z","title":"Speech is silver, silence is golden: What do asvspoof- trained models really learn?","venue":null,"work_id":"2104d9aa-aaed-4295-b830-0fa734756be7","year":2021},"citing_paper":{"arxiv_id":"2507.01750","last_updated":"2025-07-02T14:28:11Z","snapshot_observed_at":"2026-08-20T07:27:39.514940Z","submitted_at":"2025-07-02T14:28:11Z","title":"Generalizable Detection of Audio Deepfakes","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-06T20:50:16.831773Z"},"links":{"citing_paper":"/paper/2507.01750"},"observation_digest":"sha256:b3c81c0f139a0dc07eb10e5d00d68cc5baa51da9c2b509168e50a6a96a2a48ee","observation_id":"0466529b-99dd-4381-8b0b-dc252eef9255","resolution":{"observed_at":"2026-08-06T20:50:21.261435Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T20:50:20.884315Z","title":"Investigating self-supervised front ends for speech spoofing countermeasures,","venue":null,"work_id":"16b9c519-cb2d-4961-ab4f-477423f9c827","year":2022},"citing_paper":{"arxiv_id":"2507.01750","last_updated":"2025-07-02T14:28:11Z","snapshot_observed_at":"2026-08-20T07:27:39.514940Z","submitted_at":"2025-07-02T14:28:11Z","title":"Generalizable Detection of Audio Deepfakes","version":1},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-06T20:50:16.836075Z"},"links":{"citing_paper":"/paper/2507.01750"},"observation_digest":"sha256:bedcee07f854ca256eeab81fa5ca410c642e05c14de142d2f33af96b9218c837","observation_id":"10388cf0-b1f2-49a4-a716-0ad16d963502","resolution":{"observed_at":"2026-08-06T20:50:20.981115Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T20:50:20.755613Z","title":"Does audio deepfake detection generalize?","venue":null,"work_id":"dec7ca69-c138-45f9-a99a-622bf2a69056","year":2022},"citing_paper":{"arxiv_id":"2507.01750","last_updated":"2025-07-02T14:28:11Z","snapshot_observed_at":"2026-08-20T07:27:39.514940Z","submitted_at":"2025-07-02T14:28:11Z","title":"Generalizable Detection of Audio Deepfakes","version":1},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-06T20:50:16.840516Z"},"links":{"citing_paper":"/paper/2507.01750"},"observation_digest":"sha256:0c570496f1f2de45a6c254d443b9ab3627bc909ead1f69665474fca3616215ea","observation_id":"185e1814-3f7d-4e73-b2da-b486529d3b0a","resolution":{"observed_at":"2026-08-06T20:50:20.796448Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T20:50:20.581171Z","title":"The m-ailabs speech dataset,","venue":null,"work_id":"93ac0a63-ef38-442c-9465-31b338d13ddf","year":2024},"citing_paper":{"arxiv_id":"2507.01750","last_updated":"2025-07-02T14:28:11Z","snapshot_observed_at":"2026-08-20T07:27:39.514940Z","submitted_at":"2025-07-02T14:28:11Z","title":"Generalizable Detection of Audio Deepfakes","version":1},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-06T20:50:16.845734Z"},"links":{"citing_paper":"/paper/2507.01750"},"observation_digest":"sha256:ac02f42249d5780f87e5b338de67fac351f2369d335a5d6b175fcc49d44299d8","observation_id":"986a95c6-4590-4415-859d-1ba95bf1ea35","resolution":{"observed_at":"2026-08-06T20:50:20.649076Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T20:50:16.850485Z","title":"Mlaad: The multi- language audio anti-spoofing dataset,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.01750","last_updated":"2025-07-02T14:28:11Z","snapshot_observed_at":"2026-08-20T07:27:39.514940Z","submitted_at":"2025-07-02T14:28:11Z","title":"Generalizable Detection of Audio Deepfakes","version":1},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-06T20:50:16.850485Z"},"links":{"citing_paper":"/paper/2507.01750"},"observation_digest":"sha256:c3e460a58b1dd74335ceb805803c030738ebc95dfea09ccbe507b6d1c0bf916d","observation_id":"cf5adb1d-55ff-4a3a-81ae-0504bcdfcdfe","resolution":{"observed_at":"2026-08-06T20:50:16.850485Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T20:50:20.418267Z","title":"Deepfake de- tection challenge,","venue":null,"work_id":"dfc1f211-bf39-4677-8960-6b35fdc958ea","year":2019},"citing_paper":{"arxiv_id":"2507.01750","last_updated":"2025-07-02T14:28:11Z","snapshot_observed_at":"2026-08-20T07:27:39.514940Z","submitted_at":"2025-07-02T14:28:11Z","title":"Generalizable Detection of Audio Deepfakes","version":1},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-06T20:50:16.855182Z"},"links":{"citing_paper":"/paper/2507.01750"},"observation_digest":"sha256:6e68a439ed0fd5c30ceeffbe63aa6681d5166c6ffe038a94a9180b4c4ee24671","observation_id":"5036f07c-6f49-4ca6-bf31-a1e50c72d5f3","resolution":{"observed_at":"2026-08-06T20:50:20.490890Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T20:50:16.859634Z","title":"FakeA VCeleb: A novel audio-video multimodal deepfake dataset,","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2507.01750","last_updated":"2025-07-02T14:28:11Z","snapshot_observed_at":"2026-08-20T07:27:39.514940Z","submitted_at":"2025-07-02T14:28:11Z","title":"Generalizable Detection of Audio Deepfakes","version":1},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-08-06T20:50:16.859634Z"},"links":{"citing_paper":"/paper/2507.01750"},"observation_digest":"sha256:6d344d85ed12e915f4cf7ba551ae73913a569ef7973ea264987e4dae71285760","observation_id":"324cee1f-2cb8-4fc5-abb0-5e7da24f6085","resolution":{"observed_at":"2026-08-06T20:50:16.859634Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T20:50:20.167559Z","title":"Dfdc video audio labels,","venue":null,"work_id":"fe5c6bad-fe8a-4f72-bdee-d71c78be5d52","year":2024},"citing_paper":{"arxiv_id":"2507.01750","last_updated":"2025-07-02T14:28:11Z","snapshot_observed_at":"2026-08-20T07:27:39.514940Z","submitted_at":"2025-07-02T14:28:11Z","title":"Generalizable Detection of Audio Deepfakes","version":1},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-08-06T20:50:16.864130Z"},"links":{"citing_paper":"/paper/2507.01750"},"observation_digest":"sha256:5cdf189f0ba4d414d68417357fca433bffc67d7473b49473dd552ad5eb2c1c97","observation_id":"92f81717-fdf0-4835-ba3f-4af946b064ed","resolution":{"observed_at":"2026-08-06T20:50:20.246787Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T20:50:20.048239Z","title":"SPEECON – speech databases for consumer devices: Database specification and validation,","venue":null,"work_id":"80bfba7c-194e-456b-9813-e68a8f128187","year":2002},"citing_paper":{"arxiv_id":"2507.01750","last_updated":"2025-07-02T14:28:11Z","snapshot_observed_at":"2026-08-20T07:27:39.514940Z","submitted_at":"2025-07-02T14:28:11Z","title":"Generalizable Detection of Audio Deepfakes","version":1},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-08-06T20:50:16.868686Z"},"links":{"citing_paper":"/paper/2507.01750"},"observation_digest":"sha256:5ec06a1c03b322b7129b9d16264083c66d7a5e3cd57210cc3ca9a837ee49ecc9","observation_id":"71efe77a-c01f-4854-ad0e-fd12fd30b61f","resolution":{"observed_at":"2026-08-06T20:50:20.094188Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T20:50:16.873419Z","title":"Silero vad: pre-trained enterprise-grade voice activity detector (vad), number detector and language classifier,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.01750","last_updated":"2025-07-02T14:28:11Z","snapshot_observed_at":"2026-08-20T07:27:39.514940Z","submitted_at":"2025-07-02T14:28:11Z","title":"Generalizable Detection of Audio Deepfakes","version":1},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-08-06T20:50:16.873419Z"},"links":{"citing_paper":"/paper/2507.01750"},"observation_digest":"sha256:0d9e64f1b96dd1eed5e3c2b845df25ee2b5b4e2b853b812307a23a3a32506899","observation_id":"2338ea49-b3a9-4991-b8cd-83cc2037da96","resolution":{"observed_at":"2026-08-06T20:50:16.873419Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T20:50:19.931329Z","title":"Spoofed training data for speech spoofing countermeasure can be efficiently created using neural vocoders,","venue":null,"work_id":"d214f545-09ee-469c-8507-407f939c72ea","year":2023},"citing_paper":{"arxiv_id":"2507.01750","last_updated":"2025-07-02T14:28:11Z","snapshot_observed_at":"2026-08-20T07:27:39.514940Z","submitted_at":"2025-07-02T14:28:11Z","title":"Generalizable Detection of Audio Deepfakes","version":1},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-08-06T20:50:16.878045Z"},"links":{"citing_paper":"/paper/2507.01750"},"observation_digest":"sha256:cb6eaba5bc824efa77e97529e3f4448cbf6df7b903c18ae7883b0ef34ac5ed21","observation_id":"20c55ea7-3769-4713-a5cd-45f635942fdd","resolution":{"observed_at":"2026-08-06T20:50:19.969945Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T20:50:19.820214Z","title":"Hugging face,","venue":null,"work_id":"7c630a5d-ee85-46c2-a953-1d07f166368d","year":2024},"citing_paper":{"arxiv_id":"2507.01750","last_updated":"2025-07-02T14:28:11Z","snapshot_observed_at":"2026-08-20T07:27:39.514940Z","submitted_at":"2025-07-02T14:28:11Z","title":"Generalizable Detection of Audio Deepfakes","version":1},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-08-06T20:50:16.882421Z"},"links":{"citing_paper":"/paper/2507.01750"},"observation_digest":"sha256:6609cec19d0ec7dfb495f3697de6bcc0fef76d341f8b174335d852081afbc558","observation_id":"c9d31b9f-5001-4059-b481-ec347d10cf32","resolution":{"observed_at":"2026-08-06T20:50:19.862615Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T20:50:19.699061Z","title":"Hifi-gan: Generative adversarial networks for efficient and high fidelity speech synthesis,","venue":null,"work_id":"056de369-3d27-41ab-a105-b5b84f2d3c67","year":2020},"citing_paper":{"arxiv_id":"2507.01750","last_updated":"2025-07-02T14:28:11Z","snapshot_observed_at":"2026-08-20T07:27:39.514940Z","submitted_at":"2025-07-02T14:28:11Z","title":"Generalizable Detection of Audio Deepfakes","version":1},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-08-06T20:50:16.886910Z"},"links":{"citing_paper":"/paper/2507.01750"},"observation_digest":"sha256:6036b3e04b29a40aa1a6d30ecede33c0ffdfa7e5ff5847315c83dc9b47ebd7dd","observation_id":"3769c3d5-1217-47cf-b35b-1fde16751b41","resolution":{"observed_at":"2026-08-06T20:50:19.751014Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T20:50:19.599040Z","title":"Melgan: Generative adversarial networks for conditional waveform synthesis,","venue":null,"work_id":"663b7267-9084-4063-8512-3867c4783e8e","year":2019},"citing_paper":{"arxiv_id":"2507.01750","last_updated":"2025-07-02T14:28:11Z","snapshot_observed_at":"2026-08-20T07:27:39.514940Z","submitted_at":"2025-07-02T14:28:11Z","title":"Generalizable Detection of Audio Deepfakes","version":1},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-08-06T20:50:16.891608Z"},"links":{"citing_paper":"/paper/2507.01750"},"observation_digest":"sha256:b9e3848241c91d1843070db22ab4f8993936eaff28efac18ee9bcf4e9170de07","observation_id":"89c499ac-be46-4d53-b9f7-f61ca944f52e","resolution":{"observed_at":"2026-08-06T20:50:19.643729Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T20:50:19.511509Z","title":"World: A vocoder- based high-quality speech synthesis system for real-time applications,","venue":null,"work_id":"9aa11ad3-2a11-483d-9eae-9854aafa978e","year":2016},"citing_paper":{"arxiv_id":"2507.01750","last_updated":"2025-07-02T14:28:11Z","snapshot_observed_at":"2026-08-20T07:27:39.514940Z","submitted_at":"2025-07-02T14:28:11Z","title":"Generalizable Detection of Audio Deepfakes","version":1},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-08-06T20:50:16.895938Z"},"links":{"citing_paper":"/paper/2507.01750"},"observation_digest":"sha256:f3fbfc30919ef3cdaea4841663c841a146edc5208bc6681f02172b5f15ee6ecc","observation_id":"1cabab34-cf5c-46d6-b414-46e6ac8c3086","resolution":{"observed_at":"2026-08-06T20:50:19.548369Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T20:50:19.410354Z","title":"Waveglow: A flow-based generative network for speech synthesis,","venue":null,"work_id":"17a47caf-ec87-4bb7-b535-a67b36a02248","year":2018},"citing_paper":{"arxiv_id":"2507.01750","last_updated":"2025-07-02T14:28:11Z","snapshot_observed_at":"2026-08-20T07:27:39.514940Z","submitted_at":"2025-07-02T14:28:11Z","title":"Generalizable Detection of Audio Deepfakes","version":1},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-08-06T20:50:16.900487Z"},"links":{"citing_paper":"/paper/2507.01750"},"observation_digest":"sha256:cade5b51aeb595307709e298d84dfe33dded74ca37bc619f49e7189ef23fa1fa","observation_id":"f2fe1ac6-b347-42c5-b39f-be58d14988b0","resolution":{"observed_at":"2026-08-06T20:50:19.448921Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T20:50:19.302051Z","title":"Neural Source-Filter Wave- form Models for Statistical Parametric Speech Synthesis,","venue":null,"work_id":"c633ab6d-3a81-41c2-b36b-d0ebfc291ebf","year":2020},"citing_paper":{"arxiv_id":"2507.01750","last_updated":"2025-07-02T14:28:11Z","snapshot_observed_at":"2026-08-20T07:27:39.514940Z","submitted_at":"2025-07-02T14:28:11Z","title":"Generalizable Detection of Audio Deepfakes","version":1},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-08-06T20:50:16.904730Z"},"links":{"citing_paper":"/paper/2507.01750"},"observation_digest":"sha256:9abd13115c339a390c9fe1a96a32c5075bcb1b7e303105563847ff93ccfec6d3","observation_id":"fc3560d7-174c-4d2d-b8e8-2fc9d173f1c2","resolution":{"observed_at":"2026-08-06T20:50:19.346798Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T20:50:19.189771Z","title":"Can large-scale vocoded spoofed data improve speech spoofing countermeasure with a self-supervised front end?","venue":null,"work_id":"f914f0a9-f1a8-4b74-9f70-d67139c765a9","year":2024},"citing_paper":{"arxiv_id":"2507.01750","last_updated":"2025-07-02T14:28:11Z","snapshot_observed_at":"2026-08-20T07:27:39.514940Z","submitted_at":"2025-07-02T14:28:11Z","title":"Generalizable Detection of Audio Deepfakes","version":1},"reference_index":36,"source":"pdf_text","source_observed_at":"2026-08-06T20:50:16.909348Z"},"links":{"citing_paper":"/paper/2507.01750"},"observation_digest":"sha256:4368c86ebf9a9d974c413f235abce3ce3c70ae8c17bdf4e9baa1bca94535244d","observation_id":"e071f367-c5cc-4483-8f30-3ef9d1be8b84","resolution":{"observed_at":"2026-08-06T20:50:19.254459Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T20:50:19.082572Z","title":"The lj speech dataset,","venue":null,"work_id":"f5c4a63f-aa3d-4a8e-97a3-0eba0b4618c0","year":2017},"citing_paper":{"arxiv_id":"2507.01750","last_updated":"2025-07-02T14:28:11Z","snapshot_observed_at":"2026-08-20T07:27:39.514940Z","submitted_at":"2025-07-02T14:28:11Z","title":"Generalizable Detection of Audio Deepfakes","version":1},"reference_index":37,"source":"pdf_text","source_observed_at":"2026-08-06T20:50:16.913650Z"},"links":{"citing_paper":"/paper/2507.01750"},"observation_digest":"sha256:c0271640413307101f0abbe342e74542ee64541c505366c678288b9f26abe085","observation_id":"50f5bd35-edae-4412-a2bf-0655ac9e0131","resolution":{"observed_at":"2026-08-06T20:50:19.135544Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T20:50:18.970999Z","title":"fairseq: A fast, extensible toolkit for sequence modeling,","venue":null,"work_id":"d64f454a-e514-49f8-8c9e-2af2841fd94b","year":2019},"citing_paper":{"arxiv_id":"2507.01750","last_updated":"2025-07-02T14:28:11Z","snapshot_observed_at":"2026-08-20T07:27:39.514940Z","submitted_at":"2025-07-02T14:28:11Z","title":"Generalizable Detection of Audio Deepfakes","version":1},"reference_index":38,"source":"pdf_text","source_observed_at":"2026-08-06T20:50:16.918855Z"},"links":{"citing_paper":"/paper/2507.01750"},"observation_digest":"sha256:9858336198f492777f166018399bb6deb2f33cdb1896f65fdbb564c4c751ecfa","observation_id":"fb347732-0a6f-4212-8db8-05a46721b0ac","resolution":{"observed_at":"2026-08-06T20:50:19.013277Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T20:50:18.844936Z","title":"Stc antispoofing systems for the asvspoof2021 challenge,","venue":null,"work_id":"612d9882-ccd2-4dfa-b54e-932d20e61c97","year":2021},"citing_paper":{"arxiv_id":"2507.01750","last_updated":"2025-07-02T14:28:11Z","snapshot_observed_at":"2026-08-20T07:27:39.514940Z","submitted_at":"2025-07-02T14:28:11Z","title":"Generalizable Detection of Audio Deepfakes","version":1},"reference_index":39,"source":"pdf_text","source_observed_at":"2026-08-06T20:50:16.923404Z"},"links":{"citing_paper":"/paper/2507.01750"},"observation_digest":"sha256:9eab841bacd9165ab87d3f1a4a4ad87d89068e4009ad1f49864eddc925445a48","observation_id":"c61f8662-0d1c-45ab-bb2f-9377a2f3b748","resolution":{"observed_at":"2026-08-06T20:50:18.911561Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T20:50:18.723270Z","title":"Averaging weights leads to wider optima and better generalization,","venue":null,"work_id":"b5abcdcb-8b82-49c2-881f-f138ac5ac061","year":2019},"citing_paper":{"arxiv_id":"2507.01750","last_updated":"2025-07-02T14:28:11Z","snapshot_observed_at":"2026-08-20T07:27:39.514940Z","submitted_at":"2025-07-02T14:28:11Z","title":"Generalizable Detection of Audio Deepfakes","version":1},"reference_index":40,"source":"pdf_text","source_observed_at":"2026-08-06T20:50:16.928650Z"},"links":{"citing_paper":"/paper/2507.01750"},"observation_digest":"sha256:0b21affeb64e74596e774f56f42640bcadf96dbe598bd8e17be7f8c83fa8c9ab","observation_id":"7cde1841-c8da-46c6-9ba2-23adf4acaa32","resolution":{"observed_at":"2026-08-06T20:50:18.772247Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T20:50:18.572943Z","title":"Focal loss for dense object detection,","venue":null,"work_id":"a70617f3-45b7-4e51-a966-525589958270","year":2018},"citing_paper":{"arxiv_id":"2507.01750","last_updated":"2025-07-02T14:28:11Z","snapshot_observed_at":"2026-08-20T07:27:39.514940Z","submitted_at":"2025-07-02T14:28:11Z","title":"Generalizable Detection of Audio Deepfakes","version":1},"reference_index":41,"source":"pdf_text","source_observed_at":"2026-08-06T20:50:16.933151Z"},"links":{"citing_paper":"/paper/2507.01750"},"observation_digest":"sha256:3bac74f5e69a6acc7b7f132c28efc180f7046f140a259eab705733e6777d08c5","observation_id":"c388115b-0a68-476d-886f-82cbcb33909c","resolution":{"observed_at":"2026-08-06T20:50:18.642389Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T20:50:18.394115Z","title":"A discriminative feature learning approach for deep face recognition","venue":null,"work_id":"7db551c3-446a-4da5-b4cb-9d526185cc73","year":2016},"citing_paper":{"arxiv_id":"2507.01750","last_updated":"2025-07-02T14:28:11Z","snapshot_observed_at":"2026-08-20T07:27:39.514940Z","submitted_at":"2025-07-02T14:28:11Z","title":"Generalizable Detection of Audio Deepfakes","version":1},"reference_index":42,"source":"pdf_text","source_observed_at":"2026-08-06T20:50:16.938043Z"},"links":{"citing_paper":"/paper/2507.01750"},"observation_digest":"sha256:66e1d4ff84fb701bac2bb2e94e40730be3110dbb1cce80f9fdee5377c9e821a4","observation_id":"186616aa-2745-4f11-9750-f023fc645983","resolution":{"observed_at":"2026-08-06T20:50:18.485513Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T20:50:18.243240Z","title":"One-class learning towards synthetic voice spoofing detection,","venue":null,"work_id":"a3c613f4-e5c4-412c-adf3-5a8b7ecffe3b","year":2021},"citing_paper":{"arxiv_id":"2507.01750","last_updated":"2025-07-02T14:28:11Z","snapshot_observed_at":"2026-08-20T07:27:39.514940Z","submitted_at":"2025-07-02T14:28:11Z","title":"Generalizable Detection of Audio Deepfakes","version":1},"reference_index":43,"source":"pdf_text","source_observed_at":"2026-08-06T20:50:16.942691Z"},"links":{"citing_paper":"/paper/2507.01750"},"observation_digest":"sha256:8b250df7d451ee840460adda7deb51a0ddeb3e81e0c4b4430e52136a435205cd","observation_id":"ddbdbac7-5648-4f65-b5f6-b413c3a218e0","resolution":{"observed_at":"2026-08-06T20:50:18.294235Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T20:50:18.071671Z","title":"Asvspoof 2021: Towards spoofed and deepfake speech detection in the wild,","venue":null,"work_id":"4939bcc5-a016-4d07-ba0b-950b3d1dd5ab","year":2021},"citing_paper":{"arxiv_id":"2507.01750","last_updated":"2025-07-02T14:28:11Z","snapshot_observed_at":"2026-08-20T07:27:39.514940Z","submitted_at":"2025-07-02T14:28:11Z","title":"Generalizable Detection of Audio Deepfakes","version":1},"reference_index":44,"source":"pdf_text","source_observed_at":"2026-08-06T20:50:16.947773Z"},"links":{"citing_paper":"/paper/2507.01750"},"observation_digest":"sha256:1f90ae24714c4efec94946f08960b55db5d758259df7318ce7168c3c7318e105","observation_id":"7e9744ca-d05a-4da3-b928-07d5190864ff","resolution":{"observed_at":"2026-08-06T20:50:18.163224Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T20:50:17.914064Z","title":"Rawboost: A raw data boosting and augmentation method applied to automatic speaker verification anti-spoofing,","venue":null,"work_id":"1573ae09-2c98-4cd2-9664-a342afdba96d","year":2022},"citing_paper":{"arxiv_id":"2507.01750","last_updated":"2025-07-02T14:28:11Z","snapshot_observed_at":"2026-08-20T07:27:39.514940Z","submitted_at":"2025-07-02T14:28:11Z","title":"Generalizable Detection of Audio Deepfakes","version":1},"reference_index":45,"source":"pdf_text","source_observed_at":"2026-08-06T20:50:16.952065Z"},"links":{"citing_paper":"/paper/2507.01750"},"observation_digest":"sha256:e979d9d17c3552b048e85a94e847acc7ac2e3bd70fb3b36f5f6eae3332059de6","observation_id":"38d45f89-8b0b-4404-a903-129cb51c18e2","resolution":{"observed_at":"2026-08-06T20:50:18.001991Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T20:50:17.715545Z","title":"A binaural room impulse response database for the evaluation of dereverberation algorithms,","venue":null,"work_id":"523c7a97-5bbe-473a-bf31-98b304df693f","year":2009},"citing_paper":{"arxiv_id":"2507.01750","last_updated":"2025-07-02T14:28:11Z","snapshot_observed_at":"2026-08-20T07:27:39.514940Z","submitted_at":"2025-07-02T14:28:11Z","title":"Generalizable Detection of Audio Deepfakes","version":1},"reference_index":46,"source":"pdf_text","source_observed_at":"2026-08-06T20:50:16.956673Z"},"links":{"citing_paper":"/paper/2507.01750"},"observation_digest":"sha256:2b7ca5e574fa8cb03c8e57a4aca47a29ed2038e11d246cdeb9a1deb95be8d128","observation_id":"537dce94-5783-4dcc-872b-5edc014087d4","resolution":{"observed_at":"2026-08-06T20:50:17.807239Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T20:50:17.624539Z","title":"Ustc-kxdigit system description for asvspoof5 challenge,","venue":null,"work_id":"db9ad77a-434c-4ee1-b44f-b35cce7c45f3","year":null},"citing_paper":{"arxiv_id":"2507.01750","last_updated":"2025-07-02T14:28:11Z","snapshot_observed_at":"2026-08-20T07:27:39.514940Z","submitted_at":"2025-07-02T14:28:11Z","title":"Generalizable Detection of Audio Deepfakes","version":1},"reference_index":47,"source":"pdf_text","source_observed_at":"2026-08-06T20:50:16.961972Z"},"links":{"citing_paper":"/paper/2507.01750"},"observation_digest":"sha256:5b5138303c500762f4bd225d4baef1049a7ef35d5578f05a8647e13f0ae97966","observation_id":"9e12b4eb-8065-404b-b37e-6780049b66c3","resolution":{"observed_at":"2026-08-06T20:50:17.653535Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2210.13438","last_updated":"2022-10-24T17:52:02Z","snapshot_observed_at":"2026-08-15T04:43:16.361751Z","submitted_at":"2022-10-24T17:52:02Z","title":"High Fidelity Neural Audio Compression","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2210.13438","snapshot_observed_at":"2026-08-06T20:50:16.971975Z","title":"High fidelity neural audio compression,","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2507.01750","last_updated":"2025-07-02T14:28:11Z","snapshot_observed_at":"2026-08-20T07:27:39.514940Z","submitted_at":"2025-07-02T14:28:11Z","title":"Generalizable Detection of Audio Deepfakes","version":1},"reference_index":48,"source":"pdf_text","source_observed_at":"2026-08-06T20:50:16.971975Z"},"links":{"cited_paper":"/paper/2210.13438","citing_paper":"/paper/2507.01750"},"observation_digest":"sha256:7f76f720aacbcd5520fd096ca72d9cfea8e314662f477267fa52608b3231e78a","observation_id":"42cb75f9-39b7-423c-bb7c-3bc589e478c5","resolution":{"observed_at":"2026-08-06T20:50:16.971975Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T20:50:17.450542Z","title":"Probabilistic outputs for support vector machines and comparisons to regularized likelihood methods,","venue":null,"work_id":"4c0ac576-7221-4886-93d9-692b26879c8d","year":1999},"citing_paper":{"arxiv_id":"2507.01750","last_updated":"2025-07-02T14:28:11Z","snapshot_observed_at":"2026-08-20T07:27:39.514940Z","submitted_at":"2025-07-02T14:28:11Z","title":"Generalizable Detection of Audio Deepfakes","version":1},"reference_index":49,"source":"pdf_text","source_observed_at":"2026-08-06T20:50:16.976695Z"},"links":{"citing_paper":"/paper/2507.01750"},"observation_digest":"sha256:056a5aa8b972781ba14d9fc50734def9cd1b89177156dd286fbf8645269a11c9","observation_id":"54d9c851-8eb9-44ad-8477-7b4a0b123ee4","resolution":{"observed_at":"2026-08-06T20:50:17.537242Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T20:50:17.404867Z","title":"Towards measuring fairness in speech recognition: Fair-speech dataset,","venue":null,"work_id":"c748d2d6-d0dd-44a2-a5f7-b63498baf124","year":2024},"citing_paper":{"arxiv_id":"2507.01750","last_updated":"2025-07-02T14:28:11Z","snapshot_observed_at":"2026-08-20T07:27:39.514940Z","submitted_at":"2025-07-02T14:28:11Z","title":"Generalizable Detection of Audio Deepfakes","version":1},"reference_index":50,"source":"pdf_text","source_observed_at":"2026-08-06T20:50:16.981021Z"},"links":{"citing_paper":"/paper/2507.01750"},"observation_digest":"sha256:e104c4741d66179abe3c28d16965c4517883f6a82582c07ae32c4c8b344293d6","observation_id":"41011f27-23cf-42fb-95ac-dfee072b23b0","resolution":{"observed_at":"2026-08-06T20:50:17.419346Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T20:50:17.366135Z","title":"Torchaudio-squim: Reference-less speech quality and intelligi- bility measures in torchaudio,","venue":null,"work_id":"202993ef-991c-4070-9aba-7ee30e66da7b","year":2023},"citing_paper":{"arxiv_id":"2507.01750","last_updated":"2025-07-02T14:28:11Z","snapshot_observed_at":"2026-08-20T07:27:39.514940Z","submitted_at":"2025-07-02T14:28:11Z","title":"Generalizable Detection of Audio Deepfakes","version":1},"reference_index":51,"source":"pdf_text","source_observed_at":"2026-08-06T20:50:16.986076Z"},"links":{"citing_paper":"/paper/2507.01750"},"observation_digest":"sha256:b38b25030f7bcaffef900e2bbfed1d05c627e69d6db13888f7d9e2e427b13e7a","observation_id":"95796c49-dddb-4e52-a0e9-09eb7ba09949","resolution":{"observed_at":"2026-08-06T20:50:17.378615Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2409.01695","last_updated":"2024-09-03T08:28:58Z","snapshot_observed_at":"2026-08-18T03:36:38.928543Z","submitted_at":"2024-09-03T08:28:58Z","title":"USTC-KXDIGIT System Description for ASVspoof5 Challenge","version":1},"cited_work":{"arxiv_id":"2409.01695","doi":null,"metadata_source":"pith","pith_arxiv_id":"2409.01695","snapshot_observed_at":"2026-08-06T20:50:17.039193Z","title":"USTC-KXDIGIT System Description for ASVspoof5 Challenge","venue":"cs.SD","work_id":"fa8177f3-66da-4a59-a184-7b4668ddc336","year":2024},"citing_paper":{"arxiv_id":"2507.01750","last_updated":"2025-07-02T14:28:11Z","snapshot_observed_at":"2026-08-20T07:27:39.514940Z","submitted_at":"2025-07-02T14:28:11Z","title":"Generalizable Detection of Audio Deepfakes","version":1},"reference_index":2024,"source":"pdf_text","source_observed_at":"2026-08-06T20:50:16.966998Z"},"links":{"cited_paper":"/paper/2409.01695","citing_paper":"/paper/2507.01750"},"observation_digest":"sha256:dd1a38630f54495f4e5029f704541f96cc49852ce28959b7d04ddfdbe9bcdd96","observation_id":"edbd3f11-7325-4290-ba3c-e61b03cb593d","resolution":{"observed_at":"2026-08-06T20:50:17.046952Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}}],"paper":{"arxiv_id":"2507.01750","last_updated":"2025-07-02T14:28:11Z","latest_version":1,"primary_category":"eess.AS","snapshot_observed_at":"2026-08-20T07:27:39.514940Z","submitted_at":"2025-07-02T14:28:11Z","title":"Generalizable Detection of Audio Deepfakes"},"reference_resolution":{"displayed":52,"state_counts":{"malformed_identifier":0,"metadata_mismatch":1,"parse_uncertain":0,"unresolved":6,"verified_exact":4,"verified_fuzzy":41},"total_outbound_references":52},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"thesis":"As of 21 August 2026, this Paper Citation Record lists 52 of 52 outbound references and 0 inbound Pith citation observations for arXiv:2507.01750."}