{"as_of":"2026-08-10T10:15:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:54c9d30fc07ddec1f7e2c6664cddacb80938d0eef8fb2fc9d623f9cf53725715","coverage":[{"denominator":48,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":48,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-06T18:19:58.406931Z","state":"measured"},{"denominator":48,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":48,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-10T06:31:04.303077+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2507.08626/citation-record","integrity":"/paper/2507.08626/integrity","json":"/paper/2507.08626/citation-record.json","paper":"/paper/2507.08626"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T18:19:59.459935Z","title":"Protecting world leaders against deep fakes","venue":null,"work_id":"455db352-58dd-4eff-b184-479365281b9e","year":2019},"citing_paper":{"arxiv_id":"2507.08626","last_updated":"2025-07-11T14:27:57Z","snapshot_observed_at":"2026-08-09T16:40:00.574261Z","submitted_at":"2025-07-11T14:27:57Z","title":"Phoneme-Level Analysis for Person-of-Interest Speech Deepfake Detection","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-06T18:18:54.776460Z"},"links":{"citing_paper":"/paper/2507.08626"},"observation_digest":"sha256:3e489761c8650774eb76e5af216df7192161c6e57e7c671793751e60b5a44497","observation_id":"36c658b3-32d4-4a1b-a793-1996e0648609","resolution":{"observed_at":"2026-08-06T18:19:59.465651Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T18:19:59.444521Z","title":"Detecting deep-fake videos from phoneme- viseme mismatches","venue":null,"work_id":"02aee595-338c-44c2-9f9d-715c112bfcf2","year":2020},"citing_paper":{"arxiv_id":"2507.08626","last_updated":"2025-07-11T14:27:57Z","snapshot_observed_at":"2026-08-09T16:40:00.574261Z","submitted_at":"2025-07-11T14:27:57Z","title":"Phoneme-Level Analysis for Person-of-Interest Speech Deepfake Detection","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-06T18:18:54.905893Z"},"links":{"citing_paper":"/paper/2507.08626"},"observation_digest":"sha256:992623eb026f514dbc784c23af1026799cfb2e3d1da3afeb4c2857c4867e984b","observation_id":"1dca5245-19f1-47da-898e-cb51ac205b11","resolution":{"observed_at":"2026-08-06T18:19:59.449768Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T18:19:59.429141Z","title":"Deepfake media forensics: Status and future chal- lenges","venue":null,"work_id":"8336450d-840f-4db5-ab1f-d237bbaad365","year":2025},"citing_paper":{"arxiv_id":"2507.08626","last_updated":"2025-07-11T14:27:57Z","snapshot_observed_at":"2026-08-09T16:40:00.574261Z","submitted_at":"2025-07-11T14:27:57Z","title":"Phoneme-Level Analysis for Person-of-Interest Speech Deepfake Detection","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-06T18:18:55.052027Z"},"links":{"citing_paper":"/paper/2507.08626"},"observation_digest":"sha256:fb4e0784e0c0b3846aebf30acafe786ba469a995ead85de0548e6586412c54dd","observation_id":"4d42df89-edac-465e-892c-e32b5ba2e594","resolution":{"observed_at":"2026-08-06T18:19:59.433936Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T18:19:59.408483Z","title":"Combining Automatic Speaker Verification and Prosody Analysis for Synthetic Speech Detection","venue":null,"work_id":"16ebbc13-971b-4032-84aa-b58e2848e874","year":2022},"citing_paper":{"arxiv_id":"2507.08626","last_updated":"2025-07-11T14:27:57Z","snapshot_observed_at":"2026-08-09T16:40:00.574261Z","submitted_at":"2025-07-11T14:27:57Z","title":"Phoneme-Level Analysis for Person-of-Interest Speech Deepfake Detection","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-06T18:18:55.209751Z"},"links":{"citing_paper":"/paper/2507.08626"},"observation_digest":"sha256:c074d95492124c68e20e62aec95b439ef1f00b4fc28c86e3426c3df28a35e01b","observation_id":"bdf6b344-7914-4e65-bdba-13552b9d4cee","resolution":{"observed_at":"2026-08-06T18:19:59.413629Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T18:19:59.373848Z","title":"wav2vec 2.0: A framework for self-supervised learning of speech representations","venue":null,"work_id":"b111f62c-cf63-44d2-9fc1-e5deb7cd3435","year":2020},"citing_paper":{"arxiv_id":"2507.08626","last_updated":"2025-07-11T14:27:57Z","snapshot_observed_at":"2026-08-09T16:40:00.574261Z","submitted_at":"2025-07-11T14:27:57Z","title":"Phoneme-Level Analysis for Person-of-Interest Speech Deepfake Detection","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-06T18:18:55.336051Z"},"links":{"citing_paper":"/paper/2507.08626"},"observation_digest":"sha256:08cc87b8d420a092f5151885e6f7d8cac88d33107b8a88a81125646761ee18a8","observation_id":"e4f5714d-812b-4ab2-9280-59ba57e8b4c9","resolution":{"observed_at":"2026-08-06T18:19:59.397423Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T18:19:59.358472Z","title":"Transformer ensemble for syn- thesized speech detection","venue":null,"work_id":"af21cabe-370b-4823-95cd-8cbc616ae5c3","year":2023},"citing_paper":{"arxiv_id":"2507.08626","last_updated":"2025-07-11T14:27:57Z","snapshot_observed_at":"2026-08-09T16:40:00.574261Z","submitted_at":"2025-07-11T14:27:57Z","title":"Phoneme-Level Analysis for Person-of-Interest Speech Deepfake Detection","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-06T18:18:55.436523Z"},"links":{"citing_paper":"/paper/2507.08626"},"observation_digest":"sha256:cf9ca8ae8fdf07e58054c943f942baea4c610780c3b5d65297475388106eacf9","observation_id":"adc6b7ca-484b-467c-ac98-fa968ee7ac93","resolution":{"observed_at":"2026-08-06T18:19:59.363469Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T18:19:59.340227Z","title":"Are Recent Deepfake Speech Generators Detectable? In ACM Workshop on Information Hiding and Multimedia Security, 2024","venue":null,"work_id":"5b35a56b-5a8b-42ed-a680-bbebd476d6fc","year":2024},"citing_paper":{"arxiv_id":"2507.08626","last_updated":"2025-07-11T14:27:57Z","snapshot_observed_at":"2026-08-09T16:40:00.574261Z","submitted_at":"2025-07-11T14:27:57Z","title":"Phoneme-Level Analysis for Person-of-Interest Speech Deepfake Detection","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-06T18:18:55.545623Z"},"links":{"citing_paper":"/paper/2507.08626"},"observation_digest":"sha256:c1881d572edb7fd225d34ee9a305d0d3b8adde6da60b85be32db27c585eddb71","observation_id":"6a531364-6b6b-412a-ba70-6ef63602ba73","resolution":{"observed_at":"2026-08-06T18:19:59.345696Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T18:19:59.323422Z","title":"Ljspeech phonemes dataset","venue":null,"work_id":"bb926d34-4267-45cd-b67a-7272a27a81e8","year":2023},"citing_paper":{"arxiv_id":"2507.08626","last_updated":"2025-07-11T14:27:57Z","snapshot_observed_at":"2026-08-09T16:40:00.574261Z","submitted_at":"2025-07-11T14:27:57Z","title":"Phoneme-Level Analysis for Person-of-Interest Speech Deepfake Detection","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-06T18:18:55.688632Z"},"links":{"citing_paper":"/paper/2507.08626"},"observation_digest":"sha256:0c1a16973c84a22b628ce68735766a80bbdfee7ace71a9ecaaf2d73037b64b20","observation_id":"d8f8bdd9-8800-49d6-bf6c-31277ab115f8","resolution":{"observed_at":"2026-08-06T18:19:59.328905Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T18:19:59.298758Z","title":"Listen, attend and spell: A neural network for large vocab- ulary conversational speech recognition","venue":null,"work_id":"7212f7b6-ba03-46ac-aa67-53a005f9d976","year":2016},"citing_paper":{"arxiv_id":"2507.08626","last_updated":"2025-07-11T14:27:57Z","snapshot_observed_at":"2026-08-09T16:40:00.574261Z","submitted_at":"2025-07-11T14:27:57Z","title":"Phoneme-Level Analysis for Person-of-Interest Speech Deepfake Detection","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-06T18:18:55.841674Z"},"links":{"citing_paper":"/paper/2507.08626"},"observation_digest":"sha256:8562df94785cbade0f514c6d27fb3a693ced84539ebcfa3fd66ba4d689dcdc82","observation_id":"820c03bd-a020-4c68-a018-78ec531714df","resolution":{"observed_at":"2026-08-06T18:19:59.305438Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2503.18032","last_updated":"2025-03-23T11:15:22Z","snapshot_observed_at":"2026-08-07T16:43:21.988662Z","submitted_at":"2025-03-23T11:15:22Z","title":"Anomaly Detection and Localization for Speech Deepfakes via Feature Pyramid Matching","version":1},"cited_work":{"arxiv_id":"2503.18032","doi":null,"metadata_source":"pith","pith_arxiv_id":"2503.18032","snapshot_observed_at":"2026-08-06T18:19:58.469158Z","title":"Anomaly Detection and Localization for Speech Deepfakes via Feature Pyramid Matching","venue":"cs.SD","work_id":"d82cd6b5-ea19-4884-b454-7e8fba115477","year":2025},"citing_paper":{"arxiv_id":"2507.08626","last_updated":"2025-07-11T14:27:57Z","snapshot_observed_at":"2026-08-09T16:40:00.574261Z","submitted_at":"2025-07-11T14:27:57Z","title":"Phoneme-Level Analysis for Person-of-Interest Speech Deepfake Detection","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-06T18:18:55.928539Z"},"links":{"cited_paper":"/paper/2503.18032","citing_paper":"/paper/2507.08626"},"observation_digest":"sha256:a57a2cb92bba48a7d948e406f085f51cdf772740d044fd3bf3dcff81ecb13aa9","observation_id":"f888a313-9635-4646-9b66-5a8a1498ceb8","resolution":{"observed_at":"2026-08-06T18:19:58.476400Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T18:19:59.264757Z","title":"Id-reveal: Identity-aware deepfake video detection","venue":null,"work_id":"cf115348-2260-4ec2-bcc2-b27103f4849b","year":2021},"citing_paper":{"arxiv_id":"2507.08626","last_updated":"2025-07-11T14:27:57Z","snapshot_observed_at":"2026-08-09T16:40:00.574261Z","submitted_at":"2025-07-11T14:27:57Z","title":"Phoneme-Level Analysis for Person-of-Interest Speech Deepfake Detection","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-06T18:18:56.060939Z"},"links":{"citing_paper":"/paper/2507.08626"},"observation_digest":"sha256:e68debb531dabd855296d0253355da2aafba7331910215b452f475359ed18ab6","observation_id":"ae0b0d2e-74db-470c-8ea8-8ad8f71fb4f0","resolution":{"observed_at":"2026-08-06T18:19:59.271123Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T18:19:59.246651Z","title":"Audio-visual person-of-interest deep- fake detection","venue":null,"work_id":"007e0dfe-ed5d-4b3a-8663-7093204b3f4c","year":2023},"citing_paper":{"arxiv_id":"2507.08626","last_updated":"2025-07-11T14:27:57Z","snapshot_observed_at":"2026-08-09T16:40:00.574261Z","submitted_at":"2025-07-11T14:27:57Z","title":"Phoneme-Level Analysis for Person-of-Interest Speech Deepfake Detection","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-06T18:18:56.197683Z"},"links":{"citing_paper":"/paper/2507.08626"},"observation_digest":"sha256:b3d369efd74da1cb3279d11b642cc4565557e6fb4cce01541344a80e829b4b2b","observation_id":"a08eea21-a456-47e3-a121-5ba93413652f","resolution":{"observed_at":"2026-08-06T18:19:59.252620Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T18:19:59.230978Z","title":"Open challenges in synthetic speech detection","venue":null,"work_id":"11ee6f6b-f918-45ae-8a3a-3e0a30baf511","year":2022},"citing_paper":{"arxiv_id":"2507.08626","last_updated":"2025-07-11T14:27:57Z","snapshot_observed_at":"2026-08-09T16:40:00.574261Z","submitted_at":"2025-07-11T14:27:57Z","title":"Phoneme-Level Analysis for Person-of-Interest Speech Deepfake Detection","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-06T18:18:56.323141Z"},"links":{"citing_paper":"/paper/2507.08626"},"observation_digest":"sha256:cb0d5b2da7fbf4430152514f6ff50606c4a2b4549a19d8a53fc166f3d3ce969c","observation_id":"6dcbdf3c-a978-415e-9258-77dd700da2de","resolution":{"observed_at":"2026-08-06T18:19:59.236036Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T18:19:59.215011Z","title":"Au- dio transformer for synthetic speech detection via multi- formant analysis","venue":null,"work_id":"8027ebef-b889-44ea-9674-d8a6ed2a2d1a","year":2024},"citing_paper":{"arxiv_id":"2507.08626","last_updated":"2025-07-11T14:27:57Z","snapshot_observed_at":"2026-08-09T16:40:00.574261Z","submitted_at":"2025-07-11T14:27:57Z","title":"Phoneme-Level Analysis for Person-of-Interest Speech Deepfake Detection","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-06T18:18:56.482530Z"},"links":{"citing_paper":"/paper/2507.08626"},"observation_digest":"sha256:4c6bd760e79710e6f8a3fd182a7cfb3be039da99db62f5fa5eaaf3b649d1ccbb","observation_id":"412faace-c7f1-4d6b-a4f6-03fa108dc792","resolution":{"observed_at":"2026-08-06T18:19:59.220352Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T18:19:59.196750Z","title":"Using self attention DNNs to discover phonemic fea- tures for audio deep fake detection","venue":null,"work_id":"6d39d26f-1ed1-460d-84a8-3d0e2bf2040b","year":null},"citing_paper":{"arxiv_id":"2507.08626","last_updated":"2025-07-11T14:27:57Z","snapshot_observed_at":"2026-08-09T16:40:00.574261Z","submitted_at":"2025-07-11T14:27:57Z","title":"Phoneme-Level Analysis for Person-of-Interest Speech Deepfake Detection","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-06T18:18:56.640733Z"},"links":{"citing_paper":"/paper/2507.08626"},"observation_digest":"sha256:b63d1a9aeb3d67cab6305874505d542c4070c7f2ab9647566dcfdab37674a940","observation_id":"4277800c-e222-48f0-a2c9-4d374afec817","resolution":{"observed_at":"2026-08-06T18:19:59.202177Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T18:19:59.179678Z","title":"Can spoofing countermeasure and speaker verification systems be jointly optimised? In IEEE Interna- tional Conference on Acoustics, Speech and Signal Process- ing (ICASSP), 2023","venue":null,"work_id":"965cc27e-92d2-417b-9b86-98d1e1074e8b","year":2023},"citing_paper":{"arxiv_id":"2507.08626","last_updated":"2025-07-11T14:27:57Z","snapshot_observed_at":"2026-08-09T16:40:00.574261Z","submitted_at":"2025-07-11T14:27:57Z","title":"Phoneme-Level Analysis for Person-of-Interest Speech Deepfake Detection","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-06T18:18:56.719570Z"},"links":{"citing_paper":"/paper/2507.08626"},"observation_digest":"sha256:cf81c69278bd507b3af0925e753c1ee20e738fe50e90481441237fbf5d708694","observation_id":"3e8abffe-c99b-42a1-8dac-ffc54d39bfab","resolution":{"observed_at":"2026-08-06T18:19:59.185776Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T18:19:59.162899Z","title":"Privacy and security concerns in generative ai: A compre- hensive survey","venue":null,"work_id":"b7cb8de1-9cbc-42b6-bb1f-94b72482504e","year":2024},"citing_paper":{"arxiv_id":"2507.08626","last_updated":"2025-07-11T14:27:57Z","snapshot_observed_at":"2026-08-09T16:40:00.574261Z","submitted_at":"2025-07-11T14:27:57Z","title":"Phoneme-Level Analysis for Person-of-Interest Speech Deepfake Detection","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-06T18:18:56.787348Z"},"links":{"citing_paper":"/paper/2507.08626"},"observation_digest":"sha256:a3b83e7e769e771ba9e220e9468463a458082e326dd881da594b9a5bd6a3c196","observation_id":"8ce38f85-0b4c-461e-b58a-7d895a97707c","resolution":{"observed_at":"2026-08-06T18:19:59.167921Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T18:19:59.146818Z","title":"The LJ Speech Dataset","venue":null,"work_id":"1dee82eb-af04-49ae-becf-c073a5a1b96b","year":null},"citing_paper":{"arxiv_id":"2507.08626","last_updated":"2025-07-11T14:27:57Z","snapshot_observed_at":"2026-08-09T16:40:00.574261Z","submitted_at":"2025-07-11T14:27:57Z","title":"Phoneme-Level Analysis for Person-of-Interest Speech Deepfake Detection","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-06T18:18:56.890241Z"},"links":{"citing_paper":"/paper/2507.08626"},"observation_digest":"sha256:a0f9235e89de8ea3a2ce93c5a4dcd7f810b621d694d288fe99b1184e97bd6d16","observation_id":"10baa134-627c-4067-b2af-fca04c1a9dac","resolution":{"observed_at":"2026-08-06T18:19:59.152435Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T18:19:59.127995Z","title":"Aasist: Audio anti-spoofing using integrated spectro- temporal graph attention networks","venue":null,"work_id":"a2609d77-fbc5-487f-967a-13e11c3b4cd9","year":2022},"citing_paper":{"arxiv_id":"2507.08626","last_updated":"2025-07-11T14:27:57Z","snapshot_observed_at":"2026-08-09T16:40:00.574261Z","submitted_at":"2025-07-11T14:27:57Z","title":"Phoneme-Level Analysis for Person-of-Interest Speech Deepfake Detection","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-06T18:18:57.006504Z"},"links":{"citing_paper":"/paper/2507.08626"},"observation_digest":"sha256:eadc5993d2f27a00214aaac43cb81b737b5fde90a63da5b054662a75dded3e78","observation_id":"df821a5c-9c80-406f-be09-8ccf71ce4eba","resolution":{"observed_at":"2026-08-06T18:19:59.133083Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T18:19:59.111649Z","title":"A survey on speech deepfake detection","venue":null,"work_id":"41221217-f4f9-44ea-aa69-196820a77914","year":2025},"citing_paper":{"arxiv_id":"2507.08626","last_updated":"2025-07-11T14:27:57Z","snapshot_observed_at":"2026-08-09T16:40:00.574261Z","submitted_at":"2025-07-11T14:27:57Z","title":"Phoneme-Level Analysis for Person-of-Interest Speech Deepfake Detection","version":1},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-06T18:18:57.105189Z"},"links":{"citing_paper":"/paper/2507.08626"},"observation_digest":"sha256:7323f53bedac4376c68bce5a7290a15dccc8aef2bff3647183f87b32ee9b4156","observation_id":"e9fcffdb-e577-4436-878c-9c8ee9200e63","resolution":{"observed_at":"2026-08-06T18:19:59.117104Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T18:19:59.094501Z","title":"Speaker-phonetic vector estima- tion for short duration speaker verification","venue":null,"work_id":"45406cfc-f34c-4c6c-8203-cdc0b5a0e2e1","year":2018},"citing_paper":{"arxiv_id":"2507.08626","last_updated":"2025-07-11T14:27:57Z","snapshot_observed_at":"2026-08-09T16:40:00.574261Z","submitted_at":"2025-07-11T14:27:57Z","title":"Phoneme-Level Analysis for Person-of-Interest Speech Deepfake Detection","version":1},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-06T18:18:57.206514Z"},"links":{"citing_paper":"/paper/2507.08626"},"observation_digest":"sha256:40956b05bec1bdc5927195a9e5409eb020138d165d7e8fe7a3e849049740763c","observation_id":"b8d738ac-97f9-49c8-bc91-58ca81ed0295","resolution":{"observed_at":"2026-08-06T18:19:59.099949Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T18:19:59.072311Z","title":"Deepfakes genera- tion and detection: State-of-the-art, open challenges, coun- termeasures, and way forward","venue":null,"work_id":"55baf19c-9dff-4ae4-a475-f5146ed9fbee","year":2023},"citing_paper":{"arxiv_id":"2507.08626","last_updated":"2025-07-11T14:27:57Z","snapshot_observed_at":"2026-08-09T16:40:00.574261Z","submitted_at":"2025-07-11T14:27:57Z","title":"Phoneme-Level Analysis for Person-of-Interest Speech Deepfake Detection","version":1},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-06T18:18:57.374470Z"},"links":{"citing_paper":"/paper/2507.08626"},"observation_digest":"sha256:0bcd66b069d1d268fab1e106502eec347277233bd49dc388a31bd03b8c364d9e","observation_id":"35f52f3c-f229-4f3f-bc86-7cc6a94b6d3a","resolution":{"observed_at":"2026-08-06T18:19:59.080098Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T18:19:59.054013Z","title":"Speech is silver, silence is golden: What do ASVspoof- trained models really learn? In Interspeech, 2021","venue":null,"work_id":"459083be-747f-4877-92f7-9e190b801ee3","year":2021},"citing_paper":{"arxiv_id":"2507.08626","last_updated":"2025-07-11T14:27:57Z","snapshot_observed_at":"2026-08-09T16:40:00.574261Z","submitted_at":"2025-07-11T14:27:57Z","title":"Phoneme-Level Analysis for Person-of-Interest Speech Deepfake Detection","version":1},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-06T18:18:57.548866Z"},"links":{"citing_paper":"/paper/2507.08626"},"observation_digest":"sha256:fe3f8f1ad586db13ba87fe3842e379dad22a2b4836b87a6c2a974dfcab1584b2","observation_id":"71b1ef6a-b5ec-4655-a69e-49018fcfba04","resolution":{"observed_at":"2026-08-06T18:19:59.058794Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T18:19:59.032727Z","title":"Does audio deep- fake detection generalize? In Interspeech, 2022","venue":null,"work_id":"9078578f-991b-4ce2-bc94-65ee90f02e6c","year":2022},"citing_paper":{"arxiv_id":"2507.08626","last_updated":"2025-07-11T14:27:57Z","snapshot_observed_at":"2026-08-09T16:40:00.574261Z","submitted_at":"2025-07-11T14:27:57Z","title":"Phoneme-Level Analysis for Person-of-Interest Speech Deepfake Detection","version":1},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-06T18:19:58.179885Z"},"links":{"citing_paper":"/paper/2507.08626"},"observation_digest":"sha256:3d55f73697dafa65e30bf4ae19d63c111961dd3743ce7c9671d313daabab9284","observation_id":"217e4239-1543-4cef-9b36-2414be5f5911","resolution":{"observed_at":"2026-08-06T18:19:59.040381Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T18:19:59.013083Z","title":"Replay attack detection using dnn for channel discrim- ination","venue":null,"work_id":"ba1354c9-a56b-4083-a0be-139c9292e765","year":2017},"citing_paper":{"arxiv_id":"2507.08626","last_updated":"2025-07-11T14:27:57Z","snapshot_observed_at":"2026-08-09T16:40:00.574261Z","submitted_at":"2025-07-11T14:27:57Z","title":"Phoneme-Level Analysis for Person-of-Interest Speech Deepfake Detection","version":1},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-08-06T18:19:58.190330Z"},"links":{"citing_paper":"/paper/2507.08626"},"observation_digest":"sha256:7f96c5972c9bbaa38ff1a20ffee79cd390e591c13a6a103fa8e827a36f8069a7","observation_id":"3ed14717-f952-46ad-b8b2-2510ffd2a8c4","resolution":{"observed_at":"2026-08-06T18:19:59.020992Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T18:19:58.993222Z","title":"Leveraging mixture of ex- perts for improved speech deepfake detection","venue":null,"work_id":"1b2346ce-3b0a-4932-b62c-d41f6b64d647","year":2025},"citing_paper":{"arxiv_id":"2507.08626","last_updated":"2025-07-11T14:27:57Z","snapshot_observed_at":"2026-08-09T16:40:00.574261Z","submitted_at":"2025-07-11T14:27:57Z","title":"Phoneme-Level Analysis for Person-of-Interest Speech Deepfake Detection","version":1},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-08-06T18:19:58.223481Z"},"links":{"citing_paper":"/paper/2507.08626"},"observation_digest":"sha256:d2746a0a94ca139713f863afad2e8f9f664e21f553eb740beaf06e42fdb2c749","observation_id":"c4c97209-10a9-4fc2-83a8-016e602908ff","resolution":{"observed_at":"2026-08-06T18:19:58.999212Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T18:19:58.972602Z","title":"Acoustic-to-word recog- nition with sequence-to-sequence models","venue":null,"work_id":"c7acca2a-c5cf-4f5e-909b-3073dcf9b327","year":2018},"citing_paper":{"arxiv_id":"2507.08626","last_updated":"2025-07-11T14:27:57Z","snapshot_observed_at":"2026-08-09T16:40:00.574261Z","submitted_at":"2025-07-11T14:27:57Z","title":"Phoneme-Level Analysis for Person-of-Interest Speech Deepfake Detection","version":1},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-08-06T18:19:58.236062Z"},"links":{"citing_paper":"/paper/2507.08626"},"observation_digest":"sha256:6f4010fdcfb4875961ba47df5210f1ce04d60043f5511018bc1dd2537fe587d9","observation_id":"4d280b1b-fef0-43e8-97af-a8ee5c48fd92","resolution":{"observed_at":"2026-08-06T18:19:58.981103Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T18:19:58.947699Z","title":"Librispeech: an ASR corpus based on public domain audio books","venue":null,"work_id":"dcb89467-bd73-46ad-97d8-38fd42b6f756","year":2015},"citing_paper":{"arxiv_id":"2507.08626","last_updated":"2025-07-11T14:27:57Z","snapshot_observed_at":"2026-08-09T16:40:00.574261Z","submitted_at":"2025-07-11T14:27:57Z","title":"Phoneme-Level Analysis for Person-of-Interest Speech Deepfake Detection","version":1},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-08-06T18:19:58.249104Z"},"links":{"citing_paper":"/paper/2507.08626"},"observation_digest":"sha256:6591234593cb34a5a614486a4e2b3ce30d837f4fa190e6cf8314e520bbb114fb","observation_id":"a0115095-9728-45c6-a7f6-12cc1f8d96fd","resolution":{"observed_at":"2026-08-06T18:19:58.958152Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T18:19:58.929705Z","title":"Deepfake audio detection by speaker ver- ification","venue":null,"work_id":"0bc4aaa8-f4b5-4ad2-b350-bf2387b9e108","year":2022},"citing_paper":{"arxiv_id":"2507.08626","last_updated":"2025-07-11T14:27:57Z","snapshot_observed_at":"2026-08-09T16:40:00.574261Z","submitted_at":"2025-07-11T14:27:57Z","title":"Phoneme-Level Analysis for Person-of-Interest Speech Deepfake Detection","version":1},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-08-06T18:19:58.258323Z"},"links":{"citing_paper":"/paper/2507.08626"},"observation_digest":"sha256:60eba1dd38b43c5ab24d634dc15ab3d83ef8cee238a77f1778b5b4b58cebaa61","observation_id":"44710ae5-a726-4507-b712-b53c66f53313","resolution":{"observed_at":"2026-08-06T18:19:58.935072Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T18:19:58.894757Z","title":"Training-free deepfake voice recognition by leveraging large-scale pre-trained models","venue":null,"work_id":"3200dfb9-84e6-4384-9009-247fe5d159ec","year":2024},"citing_paper":{"arxiv_id":"2507.08626","last_updated":"2025-07-11T14:27:57Z","snapshot_observed_at":"2026-08-09T16:40:00.574261Z","submitted_at":"2025-07-11T14:27:57Z","title":"Phoneme-Level Analysis for Person-of-Interest Speech Deepfake Detection","version":1},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-08-06T18:19:58.269227Z"},"links":{"citing_paper":"/paper/2507.08626"},"observation_digest":"sha256:2b3d916cd0e0a56e62f9b63bc4f86ac970771722a6ec251422944cd26117f1c0","observation_id":"8c56c921-71ac-4b36-bec2-9c743cfea4fd","resolution":{"observed_at":"2026-08-06T18:19:58.908211Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T18:19:58.868655Z","title":"Deepfake detection: A systematic lit- erature review","venue":null,"work_id":"a89e7ca1-81d6-4ce1-a545-da3cb5bdc7fd","year":2024},"citing_paper":{"arxiv_id":"2507.08626","last_updated":"2025-07-11T14:27:57Z","snapshot_observed_at":"2026-08-09T16:40:00.574261Z","submitted_at":"2025-07-11T14:27:57Z","title":"Phoneme-Level Analysis for Person-of-Interest Speech Deepfake Detection","version":1},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-08-06T18:19:58.282517Z"},"links":{"citing_paper":"/paper/2507.08626"},"observation_digest":"sha256:f506ae2bb43157f12e39334e660a9eab4e860691abdd9ed7c49f05dd07a35d0c","observation_id":"4eabc10d-acd4-4c27-b395-6d3eab66ca9d","resolution":{"observed_at":"2026-08-06T18:19:58.876759Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T18:19:58.846113Z","title":"TIMIT-TTS: a Text-to-Speech Dataset for Multimodal Synthetic Media Detection","venue":null,"work_id":"175ca103-f33d-47da-b350-2166f1e925a8","year":2023},"citing_paper":{"arxiv_id":"2507.08626","last_updated":"2025-07-11T14:27:57Z","snapshot_observed_at":"2026-08-09T16:40:00.574261Z","submitted_at":"2025-07-11T14:27:57Z","title":"Phoneme-Level Analysis for Person-of-Interest Speech Deepfake Detection","version":1},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-08-06T18:19:58.293110Z"},"links":{"citing_paper":"/paper/2507.08626"},"observation_digest":"sha256:a8e73213ff9aa3919245e2683d58e7fb05617441feb4940ddd6ef2e83274bde9","observation_id":"cd5cb245-482e-4c2d-8ce7-bf74d08c4983","resolution":{"observed_at":"2026-08-06T18:19:58.851731Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T18:19:58.825443Z","title":"The VidTIMIT database","venue":null,"work_id":"4808109f-6c2b-416a-9001-d14bb2201819","year":2002},"citing_paper":{"arxiv_id":"2507.08626","last_updated":"2025-07-11T14:27:57Z","snapshot_observed_at":"2026-08-09T16:40:00.574261Z","submitted_at":"2025-07-11T14:27:57Z","title":"Phoneme-Level Analysis for Person-of-Interest Speech Deepfake Detection","version":1},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-08-06T18:19:58.301067Z"},"links":{"citing_paper":"/paper/2507.08626"},"observation_digest":"sha256:c1a6f3ef1f8d473ee1108157da30a1fb6b443e9cd9ae674be8eed5f1b4eef094","observation_id":"ad04ad75-b7c9-43e5-bd1d-b2b51af97ccf","resolution":{"observed_at":"2026-08-06T18:19:58.831268Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T18:19:58.783231Z","title":"Hierarchi- cal structures of neural networks for phoneme recognition","venue":null,"work_id":"9796ca68-fe68-4bb2-afac-b3bdbd6eb1b8","year":2006},"citing_paper":{"arxiv_id":"2507.08626","last_updated":"2025-07-11T14:27:57Z","snapshot_observed_at":"2026-08-09T16:40:00.574261Z","submitted_at":"2025-07-11T14:27:57Z","title":"Phoneme-Level Analysis for Person-of-Interest Speech Deepfake Detection","version":1},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-08-06T18:19:58.309000Z"},"links":{"citing_paper":"/paper/2507.08626"},"observation_digest":"sha256:eea8b44098741cb62003d055a1399e43e42892e4dcfd2f829006499ecf69ad30","observation_id":"44f33877-e590-4b52-aa2a-46db7268cc3f","resolution":{"observed_at":"2026-08-06T18:19:58.799206Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T18:19:58.763775Z","title":"Phonetic and speaker variations in automatic emotion classification","venue":null,"work_id":"a21f9041-dc0d-4403-ba59-039680776564","year":2008},"citing_paper":{"arxiv_id":"2507.08626","last_updated":"2025-07-11T14:27:57Z","snapshot_observed_at":"2026-08-09T16:40:00.574261Z","submitted_at":"2025-07-11T14:27:57Z","title":"Phoneme-Level Analysis for Person-of-Interest Speech Deepfake Detection","version":1},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-08-06T18:19:58.314163Z"},"links":{"citing_paper":"/paper/2507.08626"},"observation_digest":"sha256:16c129dd20b89e4bbaf36853e84eecb4510b8200404024516b95a06a8f8fb8bb","observation_id":"bec66c1e-a87c-4d72-83dd-49de17fed117","resolution":{"observed_at":"2026-08-06T18:19:58.768873Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T18:19:58.744395Z","title":"Phoneme specific modelling and scoring techniques for anti spoofing system","venue":null,"work_id":"f1f9d25e-c7e3-44b3-bdc0-9c4404717c92","year":2019},"citing_paper":{"arxiv_id":"2507.08626","last_updated":"2025-07-11T14:27:57Z","snapshot_observed_at":"2026-08-09T16:40:00.574261Z","submitted_at":"2025-07-11T14:27:57Z","title":"Phoneme-Level Analysis for Person-of-Interest Speech Deepfake Detection","version":1},"reference_index":36,"source":"pdf_text","source_observed_at":"2026-08-06T18:19:58.320077Z"},"links":{"citing_paper":"/paper/2507.08626"},"observation_digest":"sha256:cfc4e3fb2581803369aaab0174f98df5a089e6a5106a085d62a1161d7170b5da","observation_id":"17ba0e1b-8fab-4438-846f-a8f552fe1c11","resolution":{"observed_at":"2026-08-06T18:19:58.749948Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T18:19:58.715447Z","title":"Automatic speaker verification spoofing and deepfake detection using wav2vec 2.0 and data augmentation","venue":null,"work_id":"2ba2281a-0b11-473e-b00e-9f66e5a26942","year":2022},"citing_paper":{"arxiv_id":"2507.08626","last_updated":"2025-07-11T14:27:57Z","snapshot_observed_at":"2026-08-09T16:40:00.574261Z","submitted_at":"2025-07-11T14:27:57Z","title":"Phoneme-Level Analysis for Person-of-Interest Speech Deepfake Detection","version":1},"reference_index":37,"source":"pdf_text","source_observed_at":"2026-08-06T18:19:58.333188Z"},"links":{"citing_paper":"/paper/2507.08626"},"observation_digest":"sha256:a3c69c0e5f6ac66857342511d415996078e68894d80b61dcbb7fc2bc0e543944","observation_id":"96e80b07-cc24-4199-9eaf-f080b5e9fccb","resolution":{"observed_at":"2026-08-06T18:19:58.728621Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T18:19:58.686346Z","title":"ASVspoof 2019: Future horizons in spoofed and fake audio detection","venue":null,"work_id":"95bac1a4-dbc6-41d1-9126-882cea835465","year":2019},"citing_paper":{"arxiv_id":"2507.08626","last_updated":"2025-07-11T14:27:57Z","snapshot_observed_at":"2026-08-09T16:40:00.574261Z","submitted_at":"2025-07-11T14:27:57Z","title":"Phoneme-Level Analysis for Person-of-Interest Speech Deepfake Detection","version":1},"reference_index":38,"source":"pdf_text","source_observed_at":"2026-08-06T18:19:58.340875Z"},"links":{"citing_paper":"/paper/2507.08626"},"observation_digest":"sha256:c0053ff81de2e23dc11526f722c9dee20cd0dcef016ee0972d3b7e976bb4c842","observation_id":"1460a902-95eb-40f8-813b-616c708c56b8","resolution":{"observed_at":"2026-08-06T18:19:58.695641Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T18:19:58.661510Z","title":"Superseded-CSTR VCTK Corpus: English Multi- Speaker Corpus for CSTR V oice Cloning Toolkit.University of Edinburgh","venue":null,"work_id":"1bcaa668-9c56-467e-a62e-ac37dd892bb9","year":2016},"citing_paper":{"arxiv_id":"2507.08626","last_updated":"2025-07-11T14:27:57Z","snapshot_observed_at":"2026-08-09T16:40:00.574261Z","submitted_at":"2025-07-11T14:27:57Z","title":"Phoneme-Level Analysis for Person-of-Interest Speech Deepfake Detection","version":1},"reference_index":39,"source":"pdf_text","source_observed_at":"2026-08-06T18:19:58.348032Z"},"links":{"citing_paper":"/paper/2507.08626"},"observation_digest":"sha256:1ee80ac46508745bf0e817a6ccbe179598295d631d696f7cd8808ea34b222385","observation_id":"a8403576-eba1-41ae-8a41-a4dd3a13a187","resolution":{"observed_at":"2026-08-06T18:19:58.668466Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T18:19:58.637857Z","title":"Media forensics and deepfakes: an overview","venue":null,"work_id":"9b67c09e-e74b-4a3e-9322-cc3a7272633a","year":2020},"citing_paper":{"arxiv_id":"2507.08626","last_updated":"2025-07-11T14:27:57Z","snapshot_observed_at":"2026-08-09T16:40:00.574261Z","submitted_at":"2025-07-11T14:27:57Z","title":"Phoneme-Level Analysis for Person-of-Interest Speech Deepfake Detection","version":1},"reference_index":40,"source":"pdf_text","source_observed_at":"2026-08-06T18:19:58.356152Z"},"links":{"citing_paper":"/paper/2507.08626"},"observation_digest":"sha256:7db018ec3d962fcaf2124730afe0977f76f75d7ce65f1faa5915482505569ee6","observation_id":"8b0994e2-81aa-4449-b21e-5c69a99d7711","resolution":{"observed_at":"2026-08-06T18:19:58.644757Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T18:19:58.619542Z","title":"Asvspoof 5: Design, collection and validation of resources for spoofing, deepfake, and adversarial attack detection us- ing crowdsourced speech","venue":null,"work_id":"6f7ac303-ffeb-41ed-922f-2f896a2e567e","year":2025},"citing_paper":{"arxiv_id":"2507.08626","last_updated":"2025-07-11T14:27:57Z","snapshot_observed_at":"2026-08-09T16:40:00.574261Z","submitted_at":"2025-07-11T14:27:57Z","title":"Phoneme-Level Analysis for Person-of-Interest Speech Deepfake Detection","version":1},"reference_index":41,"source":"pdf_text","source_observed_at":"2026-08-06T18:19:58.362655Z"},"links":{"citing_paper":"/paper/2507.08626"},"observation_digest":"sha256:12108de870261eb262a095a1594fc75373a2a8be8b2caecd451f31c8b71c8694","observation_id":"d7d0e26b-ad1d-4dc7-a634-836cb1f8051c","resolution":{"observed_at":"2026-08-06T18:19:58.624998Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2409.11909","last_updated":"2024-09-18T12:10:04Z","snapshot_observed_at":"2026-08-09T16:39:27.328215Z","submitted_at":"2024-09-18T12:10:04Z","title":"Mixture of Experts Fusion for Fake Audio Detection Using Frozen wav2vec 2.0","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2409.11909","snapshot_observed_at":"2026-08-06T18:19:58.367128Z","title":"Mixture of experts fusion for fake au- dio detection using frozen wav2vec 2.0","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.08626","last_updated":"2025-07-11T14:27:57Z","snapshot_observed_at":"2026-08-09T16:40:00.574261Z","submitted_at":"2025-07-11T14:27:57Z","title":"Phoneme-Level Analysis for Person-of-Interest Speech Deepfake Detection","version":1},"reference_index":42,"source":"pdf_text","source_observed_at":"2026-08-06T18:19:58.367128Z"},"links":{"cited_paper":"/paper/2409.11909","citing_paper":"/paper/2507.08626"},"observation_digest":"sha256:20e37ff26e20272d122a6593b961468b11d8acb679076241470ade6d3001ccf0","observation_id":"bdc01fa7-ccbc-4228-b0a2-afdb3228e9f5","resolution":{"observed_at":"2026-08-06T18:19:58.367128Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T18:19:58.597910Z","title":"To what extent can ASV systems naturally defend against spoofing attacks? In Interspeech,","venue":null,"work_id":"c106f8ab-48d9-4609-bf6f-993e7062ac78","year":null},"citing_paper":{"arxiv_id":"2507.08626","last_updated":"2025-07-11T14:27:57Z","snapshot_observed_at":"2026-08-09T16:40:00.574261Z","submitted_at":"2025-07-11T14:27:57Z","title":"Phoneme-Level Analysis for Person-of-Interest Speech Deepfake Detection","version":1},"reference_index":43,"source":"pdf_text","source_observed_at":"2026-08-06T18:19:58.373938Z"},"links":{"citing_paper":"/paper/2507.08626"},"observation_digest":"sha256:016e86ed656e4e97caaad0d9344c945fd46d45358cd23a4e1d3e9572ace24790","observation_id":"84c9f8be-6880-4d65-ad35-3e2994925869","resolution":{"observed_at":"2026-08-06T18:19:58.604923Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T18:19:58.576936Z","title":"A robust audio deepfake detection system via multi-view feature","venue":null,"work_id":"fad46ca2-5b9a-4dcf-8341-93a5fc6eee14","year":2024},"citing_paper":{"arxiv_id":"2507.08626","last_updated":"2025-07-11T14:27:57Z","snapshot_observed_at":"2026-08-09T16:40:00.574261Z","submitted_at":"2025-07-11T14:27:57Z","title":"Phoneme-Level Analysis for Person-of-Interest Speech Deepfake Detection","version":1},"reference_index":44,"source":"pdf_text","source_observed_at":"2026-08-06T18:19:58.379399Z"},"links":{"citing_paper":"/paper/2507.08626"},"observation_digest":"sha256:ac94a8bf0c160c4e144517d1e39aa9297b9c322f5703459fe58dabcba57d8e7e","observation_id":"c9d48e98-7636-4e1c-9951-df81a347de3c","resolution":{"observed_at":"2026-08-06T18:19:58.583244Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T18:19:58.557060Z","title":"Hybrid trans- former architectures with diverse audio features for deepfake speech classification","venue":null,"work_id":"309e74a4-8558-4623-9dc4-c54f500e4b83","year":2024},"citing_paper":{"arxiv_id":"2507.08626","last_updated":"2025-07-11T14:27:57Z","snapshot_observed_at":"2026-08-09T16:40:00.574261Z","submitted_at":"2025-07-11T14:27:57Z","title":"Phoneme-Level Analysis for Person-of-Interest Speech Deepfake Detection","version":1},"reference_index":45,"source":"pdf_text","source_observed_at":"2026-08-06T18:19:58.386360Z"},"links":{"citing_paper":"/paper/2507.08626"},"observation_digest":"sha256:380cec51a4070ff8a66dac781fb6586562da7a9a1179450eb9d103fb30de2806","observation_id":"f01f0f3f-7efc-4d3b-9a67-f81177db46e8","resolution":{"observed_at":"2026-08-06T18:19:58.563373Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T18:19:58.538065Z","title":"Phoneme-level feature discrepancies: A key to detecting sophisticated speech deepfakes","venue":null,"work_id":"c0ffcebb-2b78-4b30-9d27-9e365d2e5ba2","year":2025},"citing_paper":{"arxiv_id":"2507.08626","last_updated":"2025-07-11T14:27:57Z","snapshot_observed_at":"2026-08-09T16:40:00.574261Z","submitted_at":"2025-07-11T14:27:57Z","title":"Phoneme-Level Analysis for Person-of-Interest Speech Deepfake Detection","version":1},"reference_index":46,"source":"pdf_text","source_observed_at":"2026-08-06T18:19:58.395356Z"},"links":{"citing_paper":"/paper/2507.08626"},"observation_digest":"sha256:fde4a484c4aca2df1623dbdb573570178984f71dbf9b62dfe821900549159f58","observation_id":"8b8e3c08-7d7d-4dea-b696-cf9aa6c4372b","resolution":{"observed_at":"2026-08-06T18:19:58.543501Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T18:19:58.513232Z","title":"Audio deep- fake detection with self-supervised xls-r and sls classifier","venue":null,"work_id":"3d514ded-0aa9-4f05-9d96-3227a6180c1c","year":2024},"citing_paper":{"arxiv_id":"2507.08626","last_updated":"2025-07-11T14:27:57Z","snapshot_observed_at":"2026-08-09T16:40:00.574261Z","submitted_at":"2025-07-11T14:27:57Z","title":"Phoneme-Level Analysis for Person-of-Interest Speech Deepfake Detection","version":1},"reference_index":47,"source":"pdf_text","source_observed_at":"2026-08-06T18:19:58.400192Z"},"links":{"citing_paper":"/paper/2507.08626"},"observation_digest":"sha256:8358f5ce45c3aceb3dad1529df3b810cccf025563be0a5d52fb0a5db71984a02","observation_id":"4e33d945-0a25-4770-9c2f-c79e9c5374a1","resolution":{"observed_at":"2026-08-06T18:19:58.519839Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T18:19:58.495548Z","title":"One-class learn- ing towards synthetic voice spoofing detection","venue":null,"work_id":"171a288f-8dcd-480b-a5c1-c3a49915e105","year":2021},"citing_paper":{"arxiv_id":"2507.08626","last_updated":"2025-07-11T14:27:57Z","snapshot_observed_at":"2026-08-09T16:40:00.574261Z","submitted_at":"2025-07-11T14:27:57Z","title":"Phoneme-Level Analysis for Person-of-Interest Speech Deepfake Detection","version":1},"reference_index":48,"source":"pdf_text","source_observed_at":"2026-08-06T18:19:58.406931Z"},"links":{"citing_paper":"/paper/2507.08626"},"observation_digest":"sha256:fae44efd60a7508a04d73478dad55e9d655ecd53421ed630cebe0f1b895b2495","observation_id":"f5ef2483-4f4a-40f3-87fb-4352485bd2d4","resolution":{"observed_at":"2026-08-06T18:19:58.500843Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}}],"paper":{"arxiv_id":"2507.08626","last_updated":"2025-07-11T14:27:57Z","latest_version":1,"primary_category":"cs.SD","snapshot_observed_at":"2026-08-09T16:40:00.574261Z","submitted_at":"2025-07-11T14:27:57Z","title":"Phoneme-Level Analysis for Person-of-Interest Speech Deepfake Detection"},"reference_resolution":{"displayed":48,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":1,"verified_exact":1,"verified_fuzzy":46},"total_outbound_references":48},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"thesis":"As of 10 August 2026, this Paper Citation Record lists 48 of 48 outbound references and 0 inbound Pith citation observations for arXiv:2507.08626."}