{"as_of":"2026-08-16T16:30:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:e90583f895b3f143ed40f03c8541fbaae02fcfeb58efdd669668eaddf991798a","coverage":[{"denominator":73,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":73,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-06T00:56:07.006881Z","state":"measured"},{"denominator":77,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":77,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-16T06:30:59.297886+00:00","state":"measured"},{"denominator":4,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":4,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-06T00:55:59.944344Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"arxiv_reference","source_observed_at":"2026-07-03T07:47:44.705491Z","state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2508.04143","last_updated":"2025-08-06T07:11:36Z","snapshot_observed_at":"2026-08-16T16:30:30.398213Z","submitted_at":"2025-08-06T07:11:36Z","title":"Multilingual Source Tracing of Speech Deepfakes: A First Benchmark","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2508.04143","snapshot_observed_at":"2026-08-06T00:55:59.944344Z","title":"The National Security Agency (NSA), Federal Bureau of Investigation (FBI), and Department of Homeland Security (DHS) recently released a joint report 1","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2508.04143","last_updated":"2025-08-06T07:11:36Z","snapshot_observed_at":"2026-08-16T16:30:30.398213Z","submitted_at":"2025-08-06T07:11:36Z","title":"Multilingual Source Tracing of Speech Deepfakes: A First Benchmark","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-06T00:55:59.944344Z"},"links":{"cited_paper":"/paper/2508.04143","citing_paper":"/paper/2508.04143"},"observation_digest":"sha256:126bf5a66c5f512b0c63ecf2b825f8f084e8f0416472d83bd97808964ff89e3c","observation_id":"eee9ee7d-06e4-4f97-86d4-49a2868462e7","resolution":{"observed_at":"2026-08-06T00:55:59.944344Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2508.04143","last_updated":"2025-08-06T07:11:36Z","snapshot_observed_at":"2026-08-16T16:30:30.398213Z","submitted_at":"2025-08-06T07:11:36Z","title":"Multilingual Source Tracing of Speech Deepfakes: A First Benchmark","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2508.04143","snapshot_observed_at":"2026-08-05T21:11:15.142989Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2508.09294","last_updated":"2025-08-12T19:15:13Z","snapshot_observed_at":"2026-08-15T02:26:20.884667Z","submitted_at":"2025-08-12T19:15:13Z","title":"Fake-Mamba: Real-Time Speech Deepfake Detection Using Bidirectional Mamba as Self-Attention's Alternative","version":1},"reference_index":54,"source":"arxiv_source","source_observed_at":"2026-08-05T21:11:15.142989Z"},"links":{"cited_paper":"/paper/2508.04143","citing_paper":"/paper/2508.09294"},"observation_digest":"sha256:674ba086bff1ddeb4a3c5a7b7e507aa7a12485cc7d3565564eda8ddaceb0a7b8","observation_id":"052f1f24-f58c-4abf-b8e5-6a02b596c464","resolution":{"observed_at":"2026-08-05T21:11:15.142989Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2508.04143","last_updated":"2025-08-06T07:11:36Z","snapshot_observed_at":"2026-08-16T16:30:30.398213Z","submitted_at":"2025-08-06T07:11:36Z","title":"Multilingual Source Tracing of Speech Deepfakes: A First Benchmark","version":1},"cited_work":{"arxiv_id":"2508.04143","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2508.04143","snapshot_observed_at":"2026-07-03T07:47:44.705491Z","title":"Multilingual Source Tracing of Speech Deepfakes: A First Benchmark,","venue":null,"work_id":"75e082b6-1db7-46cb-a090-574af4223f17","year":2025},"citing_paper":{"arxiv_id":"2606.10223","last_updated":"2026-06-08T22:22:48Z","snapshot_observed_at":"2026-07-06T23:49:27.565372Z","submitted_at":"2026-06-08T22:22:48Z","title":"Dual-Branch Gated Fusion for Open-Set Audio Deepfake Source Tracing","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-06-27T14:45:45.359616Z"},"links":{"cited_paper":"/paper/2508.04143","citing_paper":"/paper/2606.10223"},"observation_digest":"sha256:a58e6a3167e552acd31af8a715ce18d5f0c16fd6e0a1cd41ec65432d65bd0ef2","observation_id":"a86b9ca3-8224-4e06-8a3c-cca52731c027","resolution":{"observed_at":"2026-07-03T03:47:35.584341Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2508.04143","last_updated":"2025-08-06T07:11:36Z","snapshot_observed_at":"2026-08-16T16:30:30.398213Z","submitted_at":"2025-08-06T07:11:36Z","title":"Multilingual Source Tracing of Speech Deepfakes: A First Benchmark","version":1},"cited_work":{"arxiv_id":"2508.04143","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2508.04143","snapshot_observed_at":"2026-07-03T07:47:44.705491Z","title":"Multilingual Source Tracing of Speech Deepfakes: A First Benchmark,","venue":null,"work_id":"75e082b6-1db7-46cb-a090-574af4223f17","year":2025},"citing_paper":{"arxiv_id":"2606.10758","last_updated":"2026-06-09T12:10:29Z","snapshot_observed_at":"2026-08-13T07:59:31.916418Z","submitted_at":"2026-06-09T12:10:29Z","title":"Anchoring the Unknown: Open-Set Model Attribution via Proxy-Anchor Learning","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-06-27T11:48:10.283990Z"},"links":{"cited_paper":"/paper/2508.04143","citing_paper":"/paper/2606.10758"},"observation_digest":"sha256:7745e9d761998c041270ce14d27da84c529109064dee664970c9c4161ec16bfd","observation_id":"9fe54787-5129-4fdd-8930-a1602660c7b2","resolution":{"observed_at":"2026-07-03T07:47:44.706974Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}}],"links":{"evidence":"/evidence","html":"/paper/2508.04143/citation-record","integrity":"/paper/2508.04143/integrity","json":"/paper/2508.04143/citation-record.json","paper":"/paper/2508.04143"},"outbound":[{"citation":{"cited_paper":{"arxiv_id":"2508.04143","last_updated":"2025-08-06T07:11:36Z","snapshot_observed_at":"2026-08-16T16:30:30.398213Z","submitted_at":"2025-08-06T07:11:36Z","title":"Multilingual Source Tracing of Speech Deepfakes: A First Benchmark","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2508.04143","snapshot_observed_at":"2026-08-06T00:55:59.944344Z","title":"The National Security Agency (NSA), Federal Bureau of Investigation (FBI), and Department of Homeland Security (DHS) recently released a joint report 1","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2508.04143","last_updated":"2025-08-06T07:11:36Z","snapshot_observed_at":"2026-08-16T16:30:30.398213Z","submitted_at":"2025-08-06T07:11:36Z","title":"Multilingual Source Tracing of Speech Deepfakes: A First Benchmark","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-06T00:55:59.944344Z"},"links":{"cited_paper":"/paper/2508.04143","citing_paper":"/paper/2508.04143"},"observation_digest":"sha256:126bf5a66c5f512b0c63ecf2b825f8f084e8f0416472d83bd97808964ff89e3c","observation_id":"eee9ee7d-06e4-4f97-86d4-49a2868462e7","resolution":{"observed_at":"2026-08-06T00:55:59.944344Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T00:56:18.160785Z","title":null,"venue":null,"work_id":"0bb57d22-9a92-4828-b421-f3acacacb86a","year":null},"citing_paper":{"arxiv_id":"2508.04143","last_updated":"2025-08-06T07:11:36Z","snapshot_observed_at":"2026-08-16T16:30:30.398213Z","submitted_at":"2025-08-06T07:11:36Z","title":"Multilingual Source Tracing of Speech Deepfakes: A First Benchmark","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-06T00:56:00.000196Z"},"links":{"citing_paper":"/paper/2508.04143"},"observation_digest":"sha256:49d02e517192a7abfb24d53497dcd72a58767ce26a37a39499a76fd4944e23e8","observation_id":"56349248-f892-4998-b83d-e720165950c0","resolution":{"observed_at":"2026-08-06T00:56:18.247231Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T00:56:17.991947Z","title":"ST Models This section introduces the models used for ST tasks","venue":null,"work_id":"6e98fe28-d29a-480c-8780-ca980aa5a7a5","year":null},"citing_paper":{"arxiv_id":"2508.04143","last_updated":"2025-08-06T07:11:36Z","snapshot_observed_at":"2026-08-16T16:30:30.398213Z","submitted_at":"2025-08-06T07:11:36Z","title":"Multilingual Source Tracing of Speech Deepfakes: A First Benchmark","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-06T00:56:00.090858Z"},"links":{"citing_paper":"/paper/2508.04143"},"observation_digest":"sha256:00d9eb93fd98e52ecd36bd45feb6c4b7b434a293786210b0fb452ea36e168d9f","observation_id":"83656398-b823-47f4-a5a5-5585f6495218","resolution":{"observed_at":"2026-08-06T00:56:18.066684Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"9872.6682","doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T00:56:07.802170Z","title":null,"venue":null,"work_id":"110de29c-181d-42a6-a5f8-5b279781e778","year":null},"citing_paper":{"arxiv_id":"2508.04143","last_updated":"2025-08-06T07:11:36Z","snapshot_observed_at":"2026-08-16T16:30:30.398213Z","submitted_at":"2025-08-06T07:11:36Z","title":"Multilingual Source Tracing of Speech Deepfakes: A First Benchmark","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-06T00:56:00.260521Z"},"links":{"citing_paper":"/paper/2508.04143"},"observation_digest":"sha256:366b6b639a7566f458efcd2d71e99d646353abdfeb0439ffb2125356df4f4757","observation_id":"ce65c883-ef87-4226-9074-6058fd955c4f","resolution":{"observed_at":"2026-08-06T00:56:07.874543Z","resolver_source":"raw_fallback","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T00:56:17.781713Z","title":"Furthermore, we first explore the effects of unseen languages and speakers in ST tasks","venue":null,"work_id":"c15fb90e-aa0c-49c9-8fa0-c6ab289ff986","year":null},"citing_paper":{"arxiv_id":"2508.04143","last_updated":"2025-08-06T07:11:36Z","snapshot_observed_at":"2026-08-16T16:30:30.398213Z","submitted_at":"2025-08-06T07:11:36Z","title":"Multilingual Source Tracing of Speech Deepfakes: A First Benchmark","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-06T00:56:00.359059Z"},"links":{"citing_paper":"/paper/2508.04143"},"observation_digest":"sha256:d678d4596382758d5067d09a2a158314ad544d5db1cd89ba57ccb072c7dc1b34","observation_id":"bb93b1e8-59f6-47d8-92ee-78fb46080183","resolution":{"observed_at":"2026-08-06T00:56:17.887350Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T00:56:17.583700Z","title":"V oxpopulitts: a large-scale multilingual tts corpus for zero-shot speech generation,","venue":null,"work_id":"2e472a2b-db77-4532-9a61-0a26a6101801","year":2025},"citing_paper":{"arxiv_id":"2508.04143","last_updated":"2025-08-06T07:11:36Z","snapshot_observed_at":"2026-08-16T16:30:30.398213Z","submitted_at":"2025-08-06T07:11:36Z","title":"Multilingual Source Tracing of Speech Deepfakes: A First Benchmark","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-06T00:56:00.448714Z"},"links":{"citing_paper":"/paper/2508.04143"},"observation_digest":"sha256:989520098870b318226e9e15bfb2576401b8307faa28051543d41a8d93606421","observation_id":"ae01e7da-84fb-40b2-b708-0e1beaa4450a","resolution":{"observed_at":"2026-08-06T00:56:17.677167Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T00:56:17.383052Z","title":"Promptvc: Flexible stylistic voice conversion in latent space driven by natural language prompts,","venue":null,"work_id":"cda228db-78cc-46d2-b3de-57d45002b442","year":2024},"citing_paper":{"arxiv_id":"2508.04143","last_updated":"2025-08-06T07:11:36Z","snapshot_observed_at":"2026-08-16T16:30:30.398213Z","submitted_at":"2025-08-06T07:11:36Z","title":"Multilingual Source Tracing of Speech Deepfakes: A First Benchmark","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-06T00:56:00.530052Z"},"links":{"citing_paper":"/paper/2508.04143"},"observation_digest":"sha256:d896cb102c36e37ebfeeba423f8a7a577c1f4ca543462b9dc1c341d1676abd28","observation_id":"967ec552-e756-4390-ae01-ca5544bdb30f","resolution":{"observed_at":"2026-08-06T00:56:17.483399Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T00:56:17.197068Z","title":"A survey on speech deep- fake detection,","venue":null,"work_id":"a3be786c-3ed9-4bf8-acfd-1d331243d765","year":2025},"citing_paper":{"arxiv_id":"2508.04143","last_updated":"2025-08-06T07:11:36Z","snapshot_observed_at":"2026-08-16T16:30:30.398213Z","submitted_at":"2025-08-06T07:11:36Z","title":"Multilingual Source Tracing of Speech Deepfakes: A First Benchmark","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-06T00:56:00.638649Z"},"links":{"citing_paper":"/paper/2508.04143"},"observation_digest":"sha256:967a898ca7a5e1558b9246b8e75f24ecfee41bb6576551ffbbefc759db5368b8","observation_id":"6e42808d-eb7f-4833-b596-c98a4085bc82","resolution":{"observed_at":"2026-08-06T00:56:17.272994Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T00:56:17.019531Z","title":"Scams and frauds in the digital age: Ml-based detection and prevention strategies,","venue":null,"work_id":"9de6e586-0a90-418b-92d9-6066e7f6e267","year":2025},"citing_paper":{"arxiv_id":"2508.04143","last_updated":"2025-08-06T07:11:36Z","snapshot_observed_at":"2026-08-16T16:30:30.398213Z","submitted_at":"2025-08-06T07:11:36Z","title":"Multilingual Source Tracing of Speech Deepfakes: A First Benchmark","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-06T00:56:00.706319Z"},"links":{"citing_paper":"/paper/2508.04143"},"observation_digest":"sha256:e3c96f31a58a46802c137c7f2df95c2ef4ad84e88a48b1366420fc9315756e6f","observation_id":"aa6542d7-7241-460d-8fbd-8c936adb741e","resolution":{"observed_at":"2026-08-06T00:56:17.116700Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T00:56:16.832249Z","title":"Ge-gnn: Gated edge-augmented graph neural network for fraud detection,","venue":null,"work_id":"3efc32c6-09c8-497e-94ff-1bb897165e81","year":2025},"citing_paper":{"arxiv_id":"2508.04143","last_updated":"2025-08-06T07:11:36Z","snapshot_observed_at":"2026-08-16T16:30:30.398213Z","submitted_at":"2025-08-06T07:11:36Z","title":"Multilingual Source Tracing of Speech Deepfakes: A First Benchmark","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-06T00:56:00.780053Z"},"links":{"citing_paper":"/paper/2508.04143"},"observation_digest":"sha256:77af0be83bd8ff605c773e737020aa08067006e185174318965d360c2e11d2fb","observation_id":"a4720805-098c-4e50-b9e4-6359792202e5","resolution":{"observed_at":"2026-08-06T00:56:16.925443Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T00:56:16.728487Z","title":"Crowd density estimation based on multi-level attention maps,","venue":null,"work_id":"14832863-6605-4871-9cd6-d89acf3f4a10","year":2021},"citing_paper":{"arxiv_id":"2508.04143","last_updated":"2025-08-06T07:11:36Z","snapshot_observed_at":"2026-08-16T16:30:30.398213Z","submitted_at":"2025-08-06T07:11:36Z","title":"Multilingual Source Tracing of Speech Deepfakes: A First Benchmark","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-06T00:56:00.859291Z"},"links":{"citing_paper":"/paper/2508.04143"},"observation_digest":"sha256:efa123e50a4cfdc50ecb2a15698842c124da2a6b0838b599a1deea81b85c40cf","observation_id":"1178f371-21f6-44bc-b078-ab8fa6c1de14","resolution":{"observed_at":"2026-08-06T00:56:16.777335Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T00:56:16.570821Z","title":"Frect: Frequency-augmented convolu- tional transformer for robust time series anomaly detection,","venue":null,"work_id":"96b05497-34af-45b8-bc9e-dcd6696a00b8","year":2025},"citing_paper":{"arxiv_id":"2508.04143","last_updated":"2025-08-06T07:11:36Z","snapshot_observed_at":"2026-08-16T16:30:30.398213Z","submitted_at":"2025-08-06T07:11:36Z","title":"Multilingual Source Tracing of Speech Deepfakes: A First Benchmark","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-06T00:56:00.991963Z"},"links":{"citing_paper":"/paper/2508.04143"},"observation_digest":"sha256:9d4be6936e4ea8e859100ba8079cd6591ae22d6442991df6a672a00ad44f573d","observation_id":"e8bd0b89-731c-4ef9-8408-f0e95b43a8d9","resolution":{"observed_at":"2026-08-06T00:56:16.666041Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T00:56:16.400688Z","title":"Decomposition-based multi-scale transformer framework for time series anomaly detection,","venue":null,"work_id":"8af610c9-e9cc-454d-872e-32985e8d6146","year":2025},"citing_paper":{"arxiv_id":"2508.04143","last_updated":"2025-08-06T07:11:36Z","snapshot_observed_at":"2026-08-16T16:30:30.398213Z","submitted_at":"2025-08-06T07:11:36Z","title":"Multilingual Source Tracing of Speech Deepfakes: A First Benchmark","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-06T00:56:01.139051Z"},"links":{"citing_paper":"/paper/2508.04143"},"observation_digest":"sha256:f97077614f95f0a478638a0d4b8caadbbe98d68c499440978f2007a8a3fb0bc1","observation_id":"fede622c-f34f-48a6-a5ed-f99a9cc74ec4","resolution":{"observed_at":"2026-08-06T00:56:16.485598Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T00:56:16.233164Z","title":"Asvspoof 2021: To- wards spoofed and deepfake speech detection in the wild,","venue":null,"work_id":"b98ce89e-aecf-453e-b66f-039d043377a8","year":2021},"citing_paper":{"arxiv_id":"2508.04143","last_updated":"2025-08-06T07:11:36Z","snapshot_observed_at":"2026-08-16T16:30:30.398213Z","submitted_at":"2025-08-06T07:11:36Z","title":"Multilingual Source Tracing of Speech Deepfakes: A First Benchmark","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-06T00:56:01.240264Z"},"links":{"citing_paper":"/paper/2508.04143"},"observation_digest":"sha256:dde3cd17fb4d3f9446f14cc46dc964722adf0786daf2a2d13678d0fd4f1cb5ca","observation_id":"08918162-dce4-4e0c-8dd4-0371f4e6b984","resolution":{"observed_at":"2026-08-06T00:56:16.311024Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T00:56:16.076070Z","title":"Asvspoof 5: Crowdsourced speech data, deepfakes, and adversarial attacks at scale,","venue":null,"work_id":"f723a459-c916-4194-b203-1882ecb1dea5","year":2024},"citing_paper":{"arxiv_id":"2508.04143","last_updated":"2025-08-06T07:11:36Z","snapshot_observed_at":"2026-08-16T16:30:30.398213Z","submitted_at":"2025-08-06T07:11:36Z","title":"Multilingual Source Tracing of Speech Deepfakes: A First Benchmark","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-06T00:56:01.346337Z"},"links":{"citing_paper":"/paper/2508.04143"},"observation_digest":"sha256:5c437130fcca695f79e3ba0c7e7066168072f13f2ec7768fdabd7df50e18995a","observation_id":"55572476-b84f-475c-9a61-c84e07adfdb7","resolution":{"observed_at":"2026-08-06T00:56:16.130982Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T00:56:15.943379Z","title":"Add 2022: The first audio deep synthesis detection challenge,","venue":null,"work_id":"0670e0f6-968a-4ee9-a485-9879f92bbc81","year":2022},"citing_paper":{"arxiv_id":"2508.04143","last_updated":"2025-08-06T07:11:36Z","snapshot_observed_at":"2026-08-16T16:30:30.398213Z","submitted_at":"2025-08-06T07:11:36Z","title":"Multilingual Source Tracing of Speech Deepfakes: A First Benchmark","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-06T00:56:01.464462Z"},"links":{"citing_paper":"/paper/2508.04143"},"observation_digest":"sha256:03eadb1c74e667af939559ffa61aad950362e511b120958294045630957134b5","observation_id":"5a73b0e2-d8cb-416b-9937-5f1a2ddb12e1","resolution":{"observed_at":"2026-08-06T00:56:16.015889Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T00:56:15.748737Z","title":"Add 2023: The second audio deep- fake detection challenge,","venue":null,"work_id":"9916a622-e481-4bde-b6d9-c7e32ad740e2","year":2023},"citing_paper":{"arxiv_id":"2508.04143","last_updated":"2025-08-06T07:11:36Z","snapshot_observed_at":"2026-08-16T16:30:30.398213Z","submitted_at":"2025-08-06T07:11:36Z","title":"Multilingual Source Tracing of Speech Deepfakes: A First Benchmark","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-06T00:56:01.569769Z"},"links":{"citing_paper":"/paper/2508.04143"},"observation_digest":"sha256:1944800cfd823a9bed2398f46cdad3a6304e00c9c84559c075ffd3ccb345e594","observation_id":"28d06135-1de1-4c0e-b633-afb3ccdcb011","resolution":{"observed_at":"2026-08-06T00:56:15.860576Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T00:56:15.611804Z","title":"Trident of poseidon: A generalized approach for detecting deepfake voices,","venue":null,"work_id":"6df52836-374a-45e6-8ccf-e3e6de1d6495","year":2024},"citing_paper":{"arxiv_id":"2508.04143","last_updated":"2025-08-06T07:11:36Z","snapshot_observed_at":"2026-08-16T16:30:30.398213Z","submitted_at":"2025-08-06T07:11:36Z","title":"Multilingual Source Tracing of Speech Deepfakes: A First Benchmark","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-06T00:56:01.669453Z"},"links":{"citing_paper":"/paper/2508.04143"},"observation_digest":"sha256:61019d60a6e6c6f6f9793f90b4221ec5324f28f1733a2ead19f01b28f8129d72","observation_id":"4101efc8-ef66-43c0-b377-b6cb9d2479c6","resolution":{"observed_at":"2026-08-06T00:56:15.690594Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T00:56:15.469173Z","title":"Xlsr-mamba: A dual-column bidirec- tional state space model for spoofing attack detection,","venue":null,"work_id":"c5921f14-c049-4ec4-af6c-40e78441b79d","year":2025},"citing_paper":{"arxiv_id":"2508.04143","last_updated":"2025-08-06T07:11:36Z","snapshot_observed_at":"2026-08-16T16:30:30.398213Z","submitted_at":"2025-08-06T07:11:36Z","title":"Multilingual Source Tracing of Speech Deepfakes: A First Benchmark","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-06T00:56:01.748111Z"},"links":{"citing_paper":"/paper/2508.04143"},"observation_digest":"sha256:814b442203fc2b5611260781de473812ebb593352e3bb5ddffc2216ffce2b0e7","observation_id":"64e5bd5a-5e7f-4d1e-b752-dcf9c086976b","resolution":{"observed_at":"2026-08-06T00:56:15.538809Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T00:56:01.842439Z","title":"Nes2net: A lightweight nested architecture for foundation model driven speech anti-spoofing,","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2508.04143","last_updated":"2025-08-06T07:11:36Z","snapshot_observed_at":"2026-08-16T16:30:30.398213Z","submitted_at":"2025-08-06T07:11:36Z","title":"Multilingual Source Tracing of Speech Deepfakes: A First Benchmark","version":1},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-06T00:56:01.842439Z"},"links":{"citing_paper":"/paper/2508.04143"},"observation_digest":"sha256:f1b81af62cd57172ce9edef1d20800077e6c093705900aee1d2b3da1cc00c82f","observation_id":"58d09424-e207-40c8-8724-545deb5c3d33","resolution":{"observed_at":"2026-08-06T00:56:01.842439Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T00:56:15.311671Z","title":"Interpretable temporal class activation representation for audio spoofing detection,","venue":null,"work_id":"820ceb43-a4d8-472c-8ce8-57f3b3754c71","year":2024},"citing_paper":{"arxiv_id":"2508.04143","last_updated":"2025-08-06T07:11:36Z","snapshot_observed_at":"2026-08-16T16:30:30.398213Z","submitted_at":"2025-08-06T07:11:36Z","title":"Multilingual Source Tracing of Speech Deepfakes: A First Benchmark","version":1},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-06T00:56:01.946925Z"},"links":{"citing_paper":"/paper/2508.04143"},"observation_digest":"sha256:55f7d2242d4bc3ca7acf4289a9296e70ff1115e653ed23bb2a922d83ddb09690","observation_id":"5254a8b5-7b4b-4fc9-a5b2-68d83211e416","resolution":{"observed_at":"2026-08-06T00:56:15.373056Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T00:56:15.169464Z","title":"Speech watermarking: An approach for the forensic analysis of digital telephonic recordings,","venue":null,"work_id":"95fadaa4-7825-4fb9-8968-0dc1a0f395a3","year":2018},"citing_paper":{"arxiv_id":"2508.04143","last_updated":"2025-08-06T07:11:36Z","snapshot_observed_at":"2026-08-16T16:30:30.398213Z","submitted_at":"2025-08-06T07:11:36Z","title":"Multilingual Source Tracing of Speech Deepfakes: A First Benchmark","version":1},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-06T00:56:02.065349Z"},"links":{"citing_paper":"/paper/2508.04143"},"observation_digest":"sha256:cc0198e62bf1c7ec400bfb802d25c54ea0b3ba403f02a0b2b530f96ed99bb300","observation_id":"1d3052c4-b041-4eef-a583-75c62baf6f0e","resolution":{"observed_at":"2026-08-06T00:56:15.229590Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T00:56:15.016027Z","title":"Digital image foren- sics via intrinsic fingerprints,","venue":null,"work_id":"6e381057-6b29-4f5f-8505-a2ae596929bd","year":2008},"citing_paper":{"arxiv_id":"2508.04143","last_updated":"2025-08-06T07:11:36Z","snapshot_observed_at":"2026-08-16T16:30:30.398213Z","submitted_at":"2025-08-06T07:11:36Z","title":"Multilingual Source Tracing of Speech Deepfakes: A First Benchmark","version":1},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-06T00:56:02.181715Z"},"links":{"citing_paper":"/paper/2508.04143"},"observation_digest":"sha256:f46c90140ed65788a7291b56a8b0dbea918b7d425f2b19a1a6ba4b26af07e433","observation_id":"37358d63-a196-433a-9053-1a1f5a7dfb76","resolution":{"observed_at":"2026-08-06T00:56:15.059054Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T00:56:14.905183Z","title":"Forensic analysis and anonymization of printed documents,","venue":null,"work_id":"5776bd46-5978-420c-9900-e9ff76b69d1b","year":2018},"citing_paper":{"arxiv_id":"2508.04143","last_updated":"2025-08-06T07:11:36Z","snapshot_observed_at":"2026-08-16T16:30:30.398213Z","submitted_at":"2025-08-06T07:11:36Z","title":"Multilingual Source Tracing of Speech Deepfakes: A First Benchmark","version":1},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-06T00:56:02.285470Z"},"links":{"citing_paper":"/paper/2508.04143"},"observation_digest":"sha256:93db686b144fdceef9d6aceec328c9f8e5e0f0b95252e5646a5714b55736c83a","observation_id":"d2c65c68-0f4e-4f88-9bc4-9d863ff7972c","resolution":{"observed_at":"2026-08-06T00:56:14.953165Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T00:56:14.799987Z","title":"Transformer for authenticating the source microphone in digital audio forensics,","venue":null,"work_id":"1046860b-66d5-4dbe-92a8-e5c03310aab5","year":2023},"citing_paper":{"arxiv_id":"2508.04143","last_updated":"2025-08-06T07:11:36Z","snapshot_observed_at":"2026-08-16T16:30:30.398213Z","submitted_at":"2025-08-06T07:11:36Z","title":"Multilingual Source Tracing of Speech Deepfakes: A First Benchmark","version":1},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-08-06T00:56:02.389620Z"},"links":{"citing_paper":"/paper/2508.04143"},"observation_digest":"sha256:aa6eda98246eb635a3f5c8827f21cd932671523abeae8551a69ad103ee55b8a1","observation_id":"ad8e7d0d-dc5a-474c-833e-d9175e36b487","resolution":{"observed_at":"2026-08-06T00:56:14.848103Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T00:56:14.696092Z","title":"Primek-net: Multi- scale spectral learning via group prime-kernel convolutional neu- ral networks for single channel speech enhancement,","venue":null,"work_id":"946cf08b-30d8-40ae-a854-8d8c859104aa","year":2025},"citing_paper":{"arxiv_id":"2508.04143","last_updated":"2025-08-06T07:11:36Z","snapshot_observed_at":"2026-08-16T16:30:30.398213Z","submitted_at":"2025-08-06T07:11:36Z","title":"Multilingual Source Tracing of Speech Deepfakes: A First Benchmark","version":1},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-08-06T00:56:02.500121Z"},"links":{"citing_paper":"/paper/2508.04143"},"observation_digest":"sha256:9fb5075b6f85b6f384a69569e3b5d46c0afc6502a44d35d545b815fb8aaba43a","observation_id":"60e8f7cb-4a42-46e7-a5e3-b6ab2276717e","resolution":{"observed_at":"2026-08-06T00:56:14.743805Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T00:56:14.563247Z","title":"Guidelines on cell phone forensics,","venue":null,"work_id":"5b15c180-d67e-4680-a90a-5d5f89c960fa","year":2007},"citing_paper":{"arxiv_id":"2508.04143","last_updated":"2025-08-06T07:11:36Z","snapshot_observed_at":"2026-08-16T16:30:30.398213Z","submitted_at":"2025-08-06T07:11:36Z","title":"Multilingual Source Tracing of Speech Deepfakes: A First Benchmark","version":1},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-08-06T00:56:02.610783Z"},"links":{"citing_paper":"/paper/2508.04143"},"observation_digest":"sha256:9374a0b296a7f383f3c9d8011b94408e8ea96eb77ba51da0fc64e56f4977cca2","observation_id":"3382003a-ff3d-4549-a42a-befa12a45748","resolution":{"observed_at":"2026-08-06T00:56:14.634731Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T00:56:14.359662Z","title":"Source cell-phone recognition from recorded speech using non-speech segments,","venue":null,"work_id":"9abbefa3-072c-4660-b4ae-74b7915688a5","year":2014},"citing_paper":{"arxiv_id":"2508.04143","last_updated":"2025-08-06T07:11:36Z","snapshot_observed_at":"2026-08-16T16:30:30.398213Z","submitted_at":"2025-08-06T07:11:36Z","title":"Multilingual Source Tracing of Speech Deepfakes: A First Benchmark","version":1},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-08-06T00:56:02.758730Z"},"links":{"citing_paper":"/paper/2508.04143"},"observation_digest":"sha256:c9f71e49310fc773625ac50ddfe12027adc3b1f64e3e767e8212014e48c1b422","observation_id":"cf32e523-1269-4edd-9360-9b2346fd045c","resolution":{"observed_at":"2026-08-06T00:56:14.467337Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T00:56:14.217268Z","title":"Forensic analysis of phone call networks,","venue":null,"work_id":"cb73b793-6298-43c1-8763-d9ff1f5ba42b","year":2013},"citing_paper":{"arxiv_id":"2508.04143","last_updated":"2025-08-06T07:11:36Z","snapshot_observed_at":"2026-08-16T16:30:30.398213Z","submitted_at":"2025-08-06T07:11:36Z","title":"Multilingual Source Tracing of Speech Deepfakes: A First Benchmark","version":1},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-08-06T00:56:02.847033Z"},"links":{"citing_paper":"/paper/2508.04143"},"observation_digest":"sha256:50a190fd96dac640bb910b0166fb0222b052d85faa5e0f7efbcae327826510b3","observation_id":"f404b511-58e9-443c-af46-6a313b632f34","resolution":{"observed_at":"2026-08-06T00:56:14.264129Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2505.00946","last_updated":"2025-05-02T01:17:03Z","snapshot_observed_at":"2026-08-16T04:28:48.245359Z","submitted_at":"2025-05-02T01:17:03Z","title":"Addressing Noise and Stochasticity in Fraud Detection for Service Networks","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2505.00946","snapshot_observed_at":"2026-08-06T00:56:02.920597Z","title":"Addressing noise and stochasticity in fraud detection for service networks,","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2508.04143","last_updated":"2025-08-06T07:11:36Z","snapshot_observed_at":"2026-08-16T16:30:30.398213Z","submitted_at":"2025-08-06T07:11:36Z","title":"Multilingual Source Tracing of Speech Deepfakes: A First Benchmark","version":1},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-08-06T00:56:02.920597Z"},"links":{"cited_paper":"/paper/2505.00946","citing_paper":"/paper/2508.04143"},"observation_digest":"sha256:a54912f40cf7ac7251328adc813a7a1fa3bf87fbda2e8d20972c21c0462189b9","observation_id":"eafc6215-46f5-4fe5-b0b4-6c63e0b63291","resolution":{"observed_at":"2026-08-06T00:56:02.920597Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T00:56:14.041584Z","title":"Source tracing of audio deepfake systems,","venue":null,"work_id":"06e9a31b-4b30-48a4-9240-0c51df728562","year":2024},"citing_paper":{"arxiv_id":"2508.04143","last_updated":"2025-08-06T07:11:36Z","snapshot_observed_at":"2026-08-16T16:30:30.398213Z","submitted_at":"2025-08-06T07:11:36Z","title":"Multilingual Source Tracing of Speech Deepfakes: A First Benchmark","version":1},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-08-06T00:56:03.017005Z"},"links":{"citing_paper":"/paper/2508.04143"},"observation_digest":"sha256:999bfa0a1b2014d652599d2e9b91f755059cd6d19c0fea80c689dfdf5d09eaba","observation_id":"19a7abc9-5459-4a15-9fed-543e378e45b6","resolution":{"observed_at":"2026-08-06T00:56:14.134743Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T00:56:13.927142Z","title":"Generalized source tracing: Detect- ing novel audio deepfake algorithm with real emphasis and fake dispersion strategy,","venue":null,"work_id":"74b2dfae-844b-4a79-89d7-d0cac785b0be","year":2024},"citing_paper":{"arxiv_id":"2508.04143","last_updated":"2025-08-06T07:11:36Z","snapshot_observed_at":"2026-08-16T16:30:30.398213Z","submitted_at":"2025-08-06T07:11:36Z","title":"Multilingual Source Tracing of Speech Deepfakes: A First Benchmark","version":1},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-08-06T00:56:03.083996Z"},"links":{"citing_paper":"/paper/2508.04143"},"observation_digest":"sha256:2d405c44812226a3e7cd664cfe345b03212c455cbc0e5944b8c5e02c7258adaf","observation_id":"1e9a8fc7-46b2-415f-b327-a3fbb29e9626","resolution":{"observed_at":"2026-08-06T00:56:13.996714Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2501.06514","last_updated":"2025-01-11T11:15:58Z","snapshot_observed_at":"2026-08-16T13:46:29.318390Z","submitted_at":"2025-01-11T11:15:58Z","title":"Neural Codec Source Tracing: Toward Comprehensive Attribution in Open-Set Condition","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2501.06514","snapshot_observed_at":"2026-08-06T00:56:03.182937Z","title":"Neural codec source tracing: Toward comprehensive attribution in open-set condition,","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2508.04143","last_updated":"2025-08-06T07:11:36Z","snapshot_observed_at":"2026-08-16T16:30:30.398213Z","submitted_at":"2025-08-06T07:11:36Z","title":"Multilingual Source Tracing of Speech Deepfakes: A First Benchmark","version":1},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-08-06T00:56:03.182937Z"},"links":{"cited_paper":"/paper/2501.06514","citing_paper":"/paper/2508.04143"},"observation_digest":"sha256:935f4da648d5c01eb2537a1bccf0fb9ef0c235aedd83362b94f7b6612ed525a1","observation_id":"a7513c1d-727f-4e63-a225-aab2471085a3","resolution":{"observed_at":"2026-08-06T00:56:03.182937Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T00:56:13.768487Z","title":"Multilingual speech translation from efficient finetuning of pretrained models,","venue":null,"work_id":"511d69d9-12b0-4d8b-8ca4-886d1e9e5860","year":2021},"citing_paper":{"arxiv_id":"2508.04143","last_updated":"2025-08-06T07:11:36Z","snapshot_observed_at":"2026-08-16T16:30:30.398213Z","submitted_at":"2025-08-06T07:11:36Z","title":"Multilingual Source Tracing of Speech Deepfakes: A First Benchmark","version":1},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-08-06T00:56:03.294255Z"},"links":{"citing_paper":"/paper/2508.04143"},"observation_digest":"sha256:3dedf11c80a04838effd417ec67f1029a6c1ac3ee251cec22703774a02b2ec8d","observation_id":"eac11690-e0f1-44d3-9d81-2f1b7c30b772","resolution":{"observed_at":"2026-08-06T00:56:13.828973Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T00:56:13.617384Z","title":"Solving the unsolvable: Translating case law in hong kong,","venue":null,"work_id":"d84d5cbf-5426-4b72-9cb4-0b887829a767","year":null},"citing_paper":{"arxiv_id":"2508.04143","last_updated":"2025-08-06T07:11:36Z","snapshot_observed_at":"2026-08-16T16:30:30.398213Z","submitted_at":"2025-08-06T07:11:36Z","title":"Multilingual Source Tracing of Speech Deepfakes: A First Benchmark","version":1},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-08-06T00:56:03.397022Z"},"links":{"citing_paper":"/paper/2508.04143"},"observation_digest":"sha256:9ab67a0d17fc4b084465b9d494110e28dde15488dc23533ced9fd9062df1b747","observation_id":"9fd16104-5ca3-4827-a987-796525d6563c","resolution":{"observed_at":"2026-08-06T00:56:13.674857Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T00:56:12.429626Z","title":"Multi-scene ro- bust speaker verification system built on improved ecapa-tdnn,","venue":null,"work_id":"8fdcb610-94a4-43bc-afb3-2c5ab19561db","year":2022},"citing_paper":{"arxiv_id":"2508.04143","last_updated":"2025-08-06T07:11:36Z","snapshot_observed_at":"2026-08-16T16:30:30.398213Z","submitted_at":"2025-08-06T07:11:36Z","title":"Multilingual Source Tracing of Speech Deepfakes: A First Benchmark","version":1},"reference_index":36,"source":"pdf_text","source_observed_at":"2026-08-06T00:56:03.997788Z"},"links":{"citing_paper":"/paper/2508.04143"},"observation_digest":"sha256:76b2dc7242fe2f48201c65152b57b0eff234c754d060797b19829f3119bfa8d6","observation_id":"00e4b416-629c-489c-96ee-92fc0653910f","resolution":{"observed_at":"2026-08-06T00:56:12.498785Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2507.00875","last_updated":"2026-06-17T18:13:36Z","snapshot_observed_at":"2026-08-09T07:48:28.674702Z","submitted_at":"2025-07-01T15:39:26Z","title":"TransLaw: A Large-Scale Dataset and Multi-Agent Benchmark Simulating Professional Translation of Hong Kong Case Law","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2507.00875","snapshot_observed_at":"2026-08-06T00:56:03.545227Z","title":"Translaw: Benchmarking large language models in multi-agent simulation of the collaborative translation,","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2508.04143","last_updated":"2025-08-06T07:11:36Z","snapshot_observed_at":"2026-08-16T16:30:30.398213Z","submitted_at":"2025-08-06T07:11:36Z","title":"Multilingual Source Tracing of Speech Deepfakes: A First Benchmark","version":1},"reference_index":37,"source":"pdf_text","source_observed_at":"2026-08-06T00:56:03.545227Z"},"links":{"cited_paper":"/paper/2507.00875","citing_paper":"/paper/2508.04143"},"observation_digest":"sha256:02ee5a47a4882218aefbde6275809052dfc1314e05951a6c6561e253f20304f2","observation_id":"9786e7e2-96f6-4a15-8928-b21ab0fadf8c","resolution":{"observed_at":"2026-08-06T00:56:03.545227Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T00:56:13.377818Z","title":"Probing the feasibility of mul- tilingual speaker anonymization,","venue":null,"work_id":"27fead65-a1b6-4bdd-9ef2-29f86500f854","year":2024},"citing_paper":{"arxiv_id":"2508.04143","last_updated":"2025-08-06T07:11:36Z","snapshot_observed_at":"2026-08-16T16:30:30.398213Z","submitted_at":"2025-08-06T07:11:36Z","title":"Multilingual Source Tracing of Speech Deepfakes: A First Benchmark","version":1},"reference_index":38,"source":"pdf_text","source_observed_at":"2026-08-06T00:56:03.658914Z"},"links":{"citing_paper":"/paper/2508.04143"},"observation_digest":"sha256:56151c159b45a247900536571d35a07d9275008fb767eec21a2d36b08f157913","observation_id":"b957727f-eccb-4d3c-944a-f7ea871ec660","resolution":{"observed_at":"2026-08-06T00:56:13.513840Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T00:56:13.072846Z","title":"Introducing multilingual pho- netic information to speaker embedding for speaker verification,","venue":null,"work_id":"04d02ac9-52d2-4908-846a-8b2bb99c20a9","year":2024},"citing_paper":{"arxiv_id":"2508.04143","last_updated":"2025-08-06T07:11:36Z","snapshot_observed_at":"2026-08-16T16:30:30.398213Z","submitted_at":"2025-08-06T07:11:36Z","title":"Multilingual Source Tracing of Speech Deepfakes: A First Benchmark","version":1},"reference_index":39,"source":"pdf_text","source_observed_at":"2026-08-06T00:56:03.803187Z"},"links":{"citing_paper":"/paper/2508.04143"},"observation_digest":"sha256:bbeedbd10e57b0ca7e711d11f2f3b0e0b0f55c55c424792ecc082f8df87c1c81","observation_id":"2f85fa83-f9a0-4a3e-a484-23b5c9735d62","resolution":{"observed_at":"2026-08-06T00:56:13.228239Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T00:56:12.834910Z","title":"Research on front-end of asv system based on mel spectrum in noise scenario,","venue":null,"work_id":"e3906918-d87d-4c9b-8716-ec9c60933aa7","year":2022},"citing_paper":{"arxiv_id":"2508.04143","last_updated":"2025-08-06T07:11:36Z","snapshot_observed_at":"2026-08-16T16:30:30.398213Z","submitted_at":"2025-08-06T07:11:36Z","title":"Multilingual Source Tracing of Speech Deepfakes: A First Benchmark","version":1},"reference_index":40,"source":"pdf_text","source_observed_at":"2026-08-06T00:56:03.871923Z"},"links":{"citing_paper":"/paper/2508.04143"},"observation_digest":"sha256:74142ed17b6306c38f6705328cccdf249173d4a6e9cd9e9e7bdda701af230237","observation_id":"3d4f59a2-7652-4d25-8c7b-c2b3532fa9db","resolution":{"observed_at":"2026-08-06T00:56:12.891550Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T00:56:12.600899Z","title":"Research on acoustic feature extractor for automatic speaker verification systerm,","venue":null,"work_id":"696a9ba7-98a1-4ed3-9283-ebf147ede759","year":2022},"citing_paper":{"arxiv_id":"2508.04143","last_updated":"2025-08-06T07:11:36Z","snapshot_observed_at":"2026-08-16T16:30:30.398213Z","submitted_at":"2025-08-06T07:11:36Z","title":"Multilingual Source Tracing of Speech Deepfakes: A First Benchmark","version":1},"reference_index":41,"source":"pdf_text","source_observed_at":"2026-08-06T00:56:03.936293Z"},"links":{"citing_paper":"/paper/2508.04143"},"observation_digest":"sha256:f3850bfe4f4754f635f358d90ab1fc14bd14dae146bfa02496f5c43487817bb6","observation_id":"bacc259c-4c30-4196-bce3-05fd809ac478","resolution":{"observed_at":"2026-08-06T00:56:12.687581Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T00:56:11.531845Z","title":"Madd: A multi-lingual multi-speaker audio deepfake detection dataset,","venue":null,"work_id":"fe92301e-623b-4dc2-870c-e2bf84665460","year":2024},"citing_paper":{"arxiv_id":"2508.04143","last_updated":"2025-08-06T07:11:36Z","snapshot_observed_at":"2026-08-16T16:30:30.398213Z","submitted_at":"2025-08-06T07:11:36Z","title":"Multilingual Source Tracing of Speech Deepfakes: A First Benchmark","version":1},"reference_index":42,"source":"pdf_text","source_observed_at":"2026-08-06T00:56:04.552136Z"},"links":{"citing_paper":"/paper/2508.04143"},"observation_digest":"sha256:48a5203f80b680fd42b98e0ee4cc39f11a0476bb778d4d03eb41b425ccf30a3c","observation_id":"1afa8729-0b48-4082-8c8a-738a29503a33","resolution":{"observed_at":"2026-08-06T00:56:11.589663Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T00:56:12.253666Z","title":"Research on speaker identifica- tion models based on cnn and additive angular margin loss,","venue":null,"work_id":"f1a98574-6ddf-42da-b336-64d0cac94fa9","year":2021},"citing_paper":{"arxiv_id":"2508.04143","last_updated":"2025-08-06T07:11:36Z","snapshot_observed_at":"2026-08-16T16:30:30.398213Z","submitted_at":"2025-08-06T07:11:36Z","title":"Multilingual Source Tracing of Speech Deepfakes: A First Benchmark","version":1},"reference_index":43,"source":"pdf_text","source_observed_at":"2026-08-06T00:56:04.061412Z"},"links":{"citing_paper":"/paper/2508.04143"},"observation_digest":"sha256:e2e942455b50f1d6afe53dc59e530255d33289463c01bb422a15a0dec04fef4c","observation_id":"a10be848-2578-4218-9daa-c8c290370de6","resolution":{"observed_at":"2026-08-06T00:56:12.324043Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T00:56:12.108236Z","title":"Conformer-based speaker recogni- tion model for real-time multi-scenarios,","venue":null,"work_id":"f4b34fe4-d8ea-4100-99b7-3f47948d217a","year":2024},"citing_paper":{"arxiv_id":"2508.04143","last_updated":"2025-08-06T07:11:36Z","snapshot_observed_at":"2026-08-16T16:30:30.398213Z","submitted_at":"2025-08-06T07:11:36Z","title":"Multilingual Source Tracing of Speech Deepfakes: A First Benchmark","version":1},"reference_index":44,"source":"pdf_text","source_observed_at":"2026-08-06T00:56:04.200284Z"},"links":{"citing_paper":"/paper/2508.04143"},"observation_digest":"sha256:3bbccae860cc7117a17b56bbfb90eeae1b863661a284c18493a9047ee69f3aa9","observation_id":"4f30c6b4-bac2-4f2b-b825-71070d464d6b","resolution":{"observed_at":"2026-08-06T00:56:12.192642Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T00:56:11.964758Z","title":"Scaling speech technology to 1,000+ languages,","venue":null,"work_id":"2a114e2a-58a7-4994-9b0c-bdd4529829d1","year":2024},"citing_paper":{"arxiv_id":"2508.04143","last_updated":"2025-08-06T07:11:36Z","snapshot_observed_at":"2026-08-16T16:30:30.398213Z","submitted_at":"2025-08-06T07:11:36Z","title":"Multilingual Source Tracing of Speech Deepfakes: A First Benchmark","version":1},"reference_index":45,"source":"pdf_text","source_observed_at":"2026-08-06T00:56:04.281691Z"},"links":{"citing_paper":"/paper/2508.04143"},"observation_digest":"sha256:d03cef94fe55302e9b3523bc6d5004bcf6db329a98bcc7fea63cd1cb6f4ecec6","observation_id":"c9d4cee2-0a91-4799-8c36-bb94fd8ac5db","resolution":{"observed_at":"2026-08-06T00:56:12.036975Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T00:56:11.835438Z","title":"Neural codec language models are zero-shot text to speech synthesizers,","venue":null,"work_id":"68709fe5-e547-4f27-88d2-eb28e4227578","year":2025},"citing_paper":{"arxiv_id":"2508.04143","last_updated":"2025-08-06T07:11:36Z","snapshot_observed_at":"2026-08-16T16:30:30.398213Z","submitted_at":"2025-08-06T07:11:36Z","title":"Multilingual Source Tracing of Speech Deepfakes: A First Benchmark","version":1},"reference_index":46,"source":"pdf_text","source_observed_at":"2026-08-06T00:56:04.380251Z"},"links":{"citing_paper":"/paper/2508.04143"},"observation_digest":"sha256:ce680da7c687ee8c5d8a3ddb0a8fd64236587d6685d4d21d4841bccdc67cec61","observation_id":"5fc77ba6-dca7-4e28-a1eb-df92620a04e3","resolution":{"observed_at":"2026-08-06T00:56:11.880182Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T00:56:11.641477Z","title":"Polyglotfake: A novel multilingual and multimodal deepfake dataset,","venue":null,"work_id":"5fae8996-57dc-4ec1-b5e7-57fa43cddb4f","year":2024},"citing_paper":{"arxiv_id":"2508.04143","last_updated":"2025-08-06T07:11:36Z","snapshot_observed_at":"2026-08-16T16:30:30.398213Z","submitted_at":"2025-08-06T07:11:36Z","title":"Multilingual Source Tracing of Speech Deepfakes: A First Benchmark","version":1},"reference_index":47,"source":"pdf_text","source_observed_at":"2026-08-06T00:56:04.463808Z"},"links":{"citing_paper":"/paper/2508.04143"},"observation_digest":"sha256:dfa7b6836125657f68c8556c54fbf683771535a17aa01b1c4c003ba9a1e91d23","observation_id":"e9ff347f-d20a-4f31-a051-0f75cc31cff0","resolution":{"observed_at":"2026-08-06T00:56:11.736451Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1510.08484","last_updated":"2015-10-28T20:59:04Z","snapshot_observed_at":"2026-08-14T22:25:51.884597Z","submitted_at":"2015-10-28T20:59:04Z","title":"MUSAN: A Music, Speech, and Noise Corpus","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1510.08484","snapshot_observed_at":"2026-08-06T00:56:05.111511Z","title":"Musan: A music, speech, and noise corpus,","venue":null,"work_id":null,"year":2015},"citing_paper":{"arxiv_id":"2508.04143","last_updated":"2025-08-06T07:11:36Z","snapshot_observed_at":"2026-08-16T16:30:30.398213Z","submitted_at":"2025-08-06T07:11:36Z","title":"Multilingual Source Tracing of Speech Deepfakes: A First Benchmark","version":1},"reference_index":48,"source":"pdf_text","source_observed_at":"2026-08-06T00:56:05.111511Z"},"links":{"cited_paper":"/paper/1510.08484","citing_paper":"/paper/2508.04143"},"observation_digest":"sha256:710d761d8a31f61383a384aabfa82a285ecc9d2e72d89b0971db3e39c97072ed","observation_id":"fd3dd8cc-d7c3-4a43-9224-d7184b963d71","resolution":{"observed_at":"2026-08-06T00:56:05.111511Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T00:56:11.436915Z","title":"Mlaad: The multi- language audio anti-spoofing dataset,","venue":null,"work_id":"3f857aeb-6bd8-4ff6-879d-c66521a72c32","year":2024},"citing_paper":{"arxiv_id":"2508.04143","last_updated":"2025-08-06T07:11:36Z","snapshot_observed_at":"2026-08-16T16:30:30.398213Z","submitted_at":"2025-08-06T07:11:36Z","title":"Multilingual Source Tracing of Speech Deepfakes: A First Benchmark","version":1},"reference_index":49,"source":"pdf_text","source_observed_at":"2026-08-06T00:56:04.671909Z"},"links":{"citing_paper":"/paper/2508.04143"},"observation_digest":"sha256:32c98886cddf3d109aa2219ceb520a6979099dacfd99cbc4e2637b8e089466bb","observation_id":"e6ee83dc-8e2b-40d1-a4d6-48b14d2fdcb8","resolution":{"observed_at":"2026-08-06T00:56:11.478947Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T00:56:11.245837Z","title":"Heterogeneity over homogeneity: Investigating multilingual speech pre-trained models for detecting audio deepfake,","venue":null,"work_id":"8f7812a8-03fd-4b53-bb7d-2c501df50c05","year":2024},"citing_paper":{"arxiv_id":"2508.04143","last_updated":"2025-08-06T07:11:36Z","snapshot_observed_at":"2026-08-16T16:30:30.398213Z","submitted_at":"2025-08-06T07:11:36Z","title":"Multilingual Source Tracing of Speech Deepfakes: A First Benchmark","version":1},"reference_index":50,"source":"pdf_text","source_observed_at":"2026-08-06T00:56:04.767943Z"},"links":{"citing_paper":"/paper/2508.04143"},"observation_digest":"sha256:8478136a957e8ee81128b8157d258b8a94048f55320409abd19dbe8f2bcbdc1f","observation_id":"3d368de1-c577-4638-9f2e-6ae12db016d9","resolution":{"observed_at":"2026-08-06T00:56:11.344934Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T00:56:11.061830Z","title":"Transferring audio deepfake detection capability across lan- guages,","venue":null,"work_id":"f7eaf861-ea80-423e-b9a7-73423ed123a6","year":2023},"citing_paper":{"arxiv_id":"2508.04143","last_updated":"2025-08-06T07:11:36Z","snapshot_observed_at":"2026-08-16T16:30:30.398213Z","submitted_at":"2025-08-06T07:11:36Z","title":"Multilingual Source Tracing of Speech Deepfakes: A First Benchmark","version":1},"reference_index":51,"source":"pdf_text","source_observed_at":"2026-08-06T00:56:04.859111Z"},"links":{"citing_paper":"/paper/2508.04143"},"observation_digest":"sha256:5dc2bb537a93b70b824de3bb035b43f550d0eae30eb83d226a10058c13850b1f","observation_id":"5b8d4906-80f4-4037-adf5-6ad719b7226b","resolution":{"observed_at":"2026-08-06T00:56:11.143453Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T00:56:10.919845Z","title":"Towards quantifying and reducing language mismatch ef- fects in cross-lingual speech anti-spoofing,","venue":null,"work_id":"3704c490-8a8a-4364-a542-1e47b44347ed","year":2024},"citing_paper":{"arxiv_id":"2508.04143","last_updated":"2025-08-06T07:11:36Z","snapshot_observed_at":"2026-08-16T16:30:30.398213Z","submitted_at":"2025-08-06T07:11:36Z","title":"Multilingual Source Tracing of Speech Deepfakes: A First Benchmark","version":1},"reference_index":52,"source":"pdf_text","source_observed_at":"2026-08-06T00:56:04.951496Z"},"links":{"citing_paper":"/paper/2508.04143"},"observation_digest":"sha256:e50ab27394e0d86b7a129c92ce996e31894ea2ffc3cabbfc228970056a781f74","observation_id":"09d36118-c90a-4228-a268-b0a937053c4e","resolution":{"observed_at":"2026-08-06T00:56:11.001860Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2412.17924","last_updated":"2025-08-06T12:54:16Z","snapshot_observed_at":"2026-08-14T06:46:35.430444Z","submitted_at":"2024-12-23T19:32:53Z","title":"Are audio DeepFake detection models polyglots?","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2412.17924","snapshot_observed_at":"2026-08-06T00:56:05.043440Z","title":"Are audio deepfake detection models polyglots?","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2508.04143","last_updated":"2025-08-06T07:11:36Z","snapshot_observed_at":"2026-08-16T16:30:30.398213Z","submitted_at":"2025-08-06T07:11:36Z","title":"Multilingual Source Tracing of Speech Deepfakes: A First Benchmark","version":1},"reference_index":53,"source":"pdf_text","source_observed_at":"2026-08-06T00:56:05.043440Z"},"links":{"cited_paper":"/paper/2412.17924","citing_paper":"/paper/2508.04143"},"observation_digest":"sha256:84ccda424ab8560f6934b66997f07d467ea80ae548d010a0cda0acd4de130606","observation_id":"90ae49ac-2900-4611-8d86-d85c891c226b","resolution":{"observed_at":"2026-08-06T00:56:05.043440Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T00:56:10.041043Z","title":"Aasist: Audio anti-spoofing us- ing integrated spectro-temporal graph attention networks,","venue":null,"work_id":"de18ae24-d98b-4a98-83f5-bef9f6a53ea2","year":2022},"citing_paper":{"arxiv_id":"2508.04143","last_updated":"2025-08-06T07:11:36Z","snapshot_observed_at":"2026-08-16T16:30:30.398213Z","submitted_at":"2025-08-06T07:11:36Z","title":"Multilingual Source Tracing of Speech Deepfakes: A First Benchmark","version":1},"reference_index":54,"source":"pdf_text","source_observed_at":"2026-08-06T00:56:05.715887Z"},"links":{"citing_paper":"/paper/2508.04143"},"observation_digest":"sha256:d653238d3b34c6ff81359b3d43f34f480973d1a64262ff9d512f7b424705e786","observation_id":"516e640b-a9a9-41e6-8f5e-9c7a0e120324","resolution":{"observed_at":"2026-08-06T00:56:10.111373Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T00:56:10.745870Z","title":"Shortcut learning in deep neural networks,","venue":null,"work_id":"c0564ae0-dad2-44e0-882a-87da77e9f6c4","year":2020},"citing_paper":{"arxiv_id":"2508.04143","last_updated":"2025-08-06T07:11:36Z","snapshot_observed_at":"2026-08-16T16:30:30.398213Z","submitted_at":"2025-08-06T07:11:36Z","title":"Multilingual Source Tracing of Speech Deepfakes: A First Benchmark","version":1},"reference_index":55,"source":"pdf_text","source_observed_at":"2026-08-06T00:56:05.252454Z"},"links":{"citing_paper":"/paper/2508.04143"},"observation_digest":"sha256:2c380e36fc9a233b921f32bf68e688bc6358fa3e0991874632045ac0b3a3eff5","observation_id":"76d3647a-110d-4bea-ba6e-371533564d59","resolution":{"observed_at":"2026-08-06T00:56:10.817527Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T00:56:10.574168Z","title":"Ecapa2: A hybrid neural net- work architecture and training strategy for robust speaker embed- dings,","venue":null,"work_id":"84000af9-7edb-4174-9474-ec97505f824f","year":2023},"citing_paper":{"arxiv_id":"2508.04143","last_updated":"2025-08-06T07:11:36Z","snapshot_observed_at":"2026-08-16T16:30:30.398213Z","submitted_at":"2025-08-06T07:11:36Z","title":"Multilingual Source Tracing of Speech Deepfakes: A First Benchmark","version":1},"reference_index":56,"source":"pdf_text","source_observed_at":"2026-08-06T00:56:05.365763Z"},"links":{"citing_paper":"/paper/2508.04143"},"observation_digest":"sha256:a4da064da99d88e10cedc0e3cf6334229d223cf45d82ba4011b53572040b4947","observation_id":"9873d17d-896c-46d2-b3eb-40784435531d","resolution":{"observed_at":"2026-08-06T00:56:10.669302Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":"10.1023/a:1007612920971","metadata_source":"openalex","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T05:30:23.456663Z","title":"Concept decompositions for large sparse text data using clustering,","venue":"Machine Learning","work_id":"2a3699ba-0c47-4d74-ad33-84c6e4c4d7d9","year":2001},"citing_paper":{"arxiv_id":"2508.04143","last_updated":"2025-08-06T07:11:36Z","snapshot_observed_at":"2026-08-16T16:30:30.398213Z","submitted_at":"2025-08-06T07:11:36Z","title":"Multilingual Source Tracing of Speech Deepfakes: A First Benchmark","version":1},"reference_index":57,"source":"pdf_text","source_observed_at":"2026-08-06T00:56:05.425866Z"},"links":{"citing_paper":"/paper/2508.04143"},"observation_digest":"sha256:93a2030f76c77df579ae364041fa5f9464bf544a62b87162abaf2498f6e6d51a","observation_id":"a579830c-3627-4dc2-8d1d-28b2c76003c6","resolution":{"observed_at":"2026-08-06T00:56:07.194218Z","resolver_source":"doi","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T00:56:10.376838Z","title":"Review on determining number of cluster in k-means clustering,","venue":null,"work_id":"0ac76abf-19ea-4314-b714-28652a0af2a1","year":2013},"citing_paper":{"arxiv_id":"2508.04143","last_updated":"2025-08-06T07:11:36Z","snapshot_observed_at":"2026-08-16T16:30:30.398213Z","submitted_at":"2025-08-06T07:11:36Z","title":"Multilingual Source Tracing of Speech Deepfakes: A First Benchmark","version":1},"reference_index":58,"source":"pdf_text","source_observed_at":"2026-08-06T00:56:05.492686Z"},"links":{"citing_paper":"/paper/2508.04143"},"observation_digest":"sha256:d4c522a043599a913af1e1a8ac3a0ef481b6cc85ca4b982489d5e1ebf20c29e6","observation_id":"dbf9e1c0-c1eb-4bc4-9ddc-265a812e853d","resolution":{"observed_at":"2026-08-06T00:56:10.465100Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T00:56:10.193727Z","title":"A comparison of features for synthetic speech detection,","venue":null,"work_id":"4d9f1cdc-3d3f-434f-9947-e84cded2e28a","year":2015},"citing_paper":{"arxiv_id":"2508.04143","last_updated":"2025-08-06T07:11:36Z","snapshot_observed_at":"2026-08-16T16:30:30.398213Z","submitted_at":"2025-08-06T07:11:36Z","title":"Multilingual Source Tracing of Speech Deepfakes: A First Benchmark","version":1},"reference_index":59,"source":"pdf_text","source_observed_at":"2026-08-06T00:56:05.594331Z"},"links":{"citing_paper":"/paper/2508.04143"},"observation_digest":"sha256:e6b61b15c7dc8c771b2c8eb6b6dfcddb2b6ee4798197cb2ec994d25191a142d9","observation_id":"e91df8d7-0cd8-477b-9fe0-cf8a1eddcc8a","resolution":{"observed_at":"2026-08-06T00:56:10.266093Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T00:56:09.101455Z","title":"Common V oice: A massively-multilingual speech corpus,","venue":null,"work_id":"39d68bbc-b3c9-4756-933f-8245b9f38862","year":2020},"citing_paper":{"arxiv_id":"2508.04143","last_updated":"2025-08-06T07:11:36Z","snapshot_observed_at":"2026-08-16T16:30:30.398213Z","submitted_at":"2025-08-06T07:11:36Z","title":"Multilingual Source Tracing of Speech Deepfakes: A First Benchmark","version":1},"reference_index":60,"source":"pdf_text","source_observed_at":"2026-08-06T00:56:06.182071Z"},"links":{"citing_paper":"/paper/2508.04143"},"observation_digest":"sha256:645a509b20ac97494e4ce39643976863db5a4eccd4ece571b8e5da43a8580acb","observation_id":"c61d3539-4c7a-4245-a015-6232547136b2","resolution":{"observed_at":"2026-08-06T00:56:09.218746Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T00:56:05.806000Z","title":"Deep residual learning for image recognition,","venue":null,"work_id":null,"year":2016},"citing_paper":{"arxiv_id":"2508.04143","last_updated":"2025-08-06T07:11:36Z","snapshot_observed_at":"2026-08-16T16:30:30.398213Z","submitted_at":"2025-08-06T07:11:36Z","title":"Multilingual Source Tracing of Speech Deepfakes: A First Benchmark","version":1},"reference_index":61,"source":"pdf_text","source_observed_at":"2026-08-06T00:56:05.806000Z"},"links":{"citing_paper":"/paper/2508.04143"},"observation_digest":"sha256:aa26625c4884f5cbc5060ae99e07cb4221fd821f7070c94c6812bb0d26b645dd","observation_id":"40b9ace0-5bb2-4ccc-a10f-8661647d8d2f","resolution":{"observed_at":"2026-08-06T00:56:05.806000Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T00:56:09.859582Z","title":"ECAPA- TDNN: Emphasized channel attention, propagation and aggrega- tion in TDNN based speaker verification,","venue":null,"work_id":"a952d350-8b33-4b98-ab5b-819214678800","year":2020},"citing_paper":{"arxiv_id":"2508.04143","last_updated":"2025-08-06T07:11:36Z","snapshot_observed_at":"2026-08-16T16:30:30.398213Z","submitted_at":"2025-08-06T07:11:36Z","title":"Multilingual Source Tracing of Speech Deepfakes: A First Benchmark","version":1},"reference_index":62,"source":"pdf_text","source_observed_at":"2026-08-06T00:56:05.874370Z"},"links":{"citing_paper":"/paper/2508.04143"},"observation_digest":"sha256:fb2c30a66c32e1c5e13bbe6f607accfc8473de14d57975d4c6be24d217537e11","observation_id":"a2423df7-60c4-4143-a36f-a1376ea346ed","resolution":{"observed_at":"2026-08-06T00:56:09.939039Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T00:56:09.682304Z","title":"Unsu- pervised cross-lingual representation learning for speech recogni- tion,","venue":null,"work_id":"70468437-2446-4d89-8b92-f9dd4425bb15","year":2021},"citing_paper":{"arxiv_id":"2508.04143","last_updated":"2025-08-06T07:11:36Z","snapshot_observed_at":"2026-08-16T16:30:30.398213Z","submitted_at":"2025-08-06T07:11:36Z","title":"Multilingual Source Tracing of Speech Deepfakes: A First Benchmark","version":1},"reference_index":63,"source":"pdf_text","source_observed_at":"2026-08-06T00:56:05.941412Z"},"links":{"citing_paper":"/paper/2508.04143"},"observation_digest":"sha256:8490b6b1497b67f154302cfc9b18348e23b8d051341b65a021a4fb0f32d3aad0","observation_id":"edb00b6a-3a84-4463-a96c-58ae836c9342","resolution":{"observed_at":"2026-08-06T00:56:09.759102Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T00:56:09.452498Z","title":"V oxpopuli: A large-scale multilingual speech corpus for representation learning, semi- supervised learning and interpretation,","venue":null,"work_id":"c19e8cfc-d849-4fd4-831f-1b0aa6ca05cb","year":2021},"citing_paper":{"arxiv_id":"2508.04143","last_updated":"2025-08-06T07:11:36Z","snapshot_observed_at":"2026-08-16T16:30:30.398213Z","submitted_at":"2025-08-06T07:11:36Z","title":"Multilingual Source Tracing of Speech Deepfakes: A First Benchmark","version":1},"reference_index":64,"source":"pdf_text","source_observed_at":"2026-08-06T00:56:06.008734Z"},"links":{"citing_paper":"/paper/2508.04143"},"observation_digest":"sha256:89fc8738a5998d7cf8aec46a408cc718951917ac1ff894bb0fab615ed757d312","observation_id":"8651a924-bad0-4147-ae96-f32a9f898d27","resolution":{"observed_at":"2026-08-06T00:56:09.570969Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T00:56:09.298007Z","title":"MLS: A large-scale multilin- gual dataset for speech research,","venue":null,"work_id":"fb5b683e-e9d3-47f9-b66c-8ddd1b8a4368","year":2020},"citing_paper":{"arxiv_id":"2508.04143","last_updated":"2025-08-06T07:11:36Z","snapshot_observed_at":"2026-08-16T16:30:30.398213Z","submitted_at":"2025-08-06T07:11:36Z","title":"Multilingual Source Tracing of Speech Deepfakes: A First Benchmark","version":1},"reference_index":65,"source":"pdf_text","source_observed_at":"2026-08-06T00:56:06.092376Z"},"links":{"citing_paper":"/paper/2508.04143"},"observation_digest":"sha256:6df5bb5d438068bccd14ae0c5e8ecf4fcdad7d0924b64b5022a60ed777380351","observation_id":"d345779e-6c42-4f7a-99f8-9353489a22fc","resolution":{"observed_at":"2026-08-06T00:56:09.385741Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1710.09412","last_updated":"2018-04-27T21:39:25Z","snapshot_observed_at":"2026-08-08T10:28:19.597631Z","submitted_at":"2017-10-25T18:30:49Z","title":"mixup: Beyond Empirical Risk Minimization","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1710.09412","snapshot_observed_at":"2026-08-06T00:56:06.907770Z","title":"mixup: Beyond empirical risk minimization,","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2508.04143","last_updated":"2025-08-06T07:11:36Z","snapshot_observed_at":"2026-08-16T16:30:30.398213Z","submitted_at":"2025-08-06T07:11:36Z","title":"Multilingual Source Tracing of Speech Deepfakes: A First Benchmark","version":1},"reference_index":66,"source":"pdf_text","source_observed_at":"2026-08-06T00:56:06.907770Z"},"links":{"cited_paper":"/paper/1710.09412","citing_paper":"/paper/2508.04143"},"observation_digest":"sha256:1820f5f75d9ff14901af1d291c4a071208d8a13310d9c899d2cc66cb582644da","observation_id":"e236270a-e5d2-4ea3-a3fe-6584f760c568","resolution":{"observed_at":"2026-08-06T00:56:06.907770Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T00:56:08.860702Z","title":"V oxlingua107: A dataset for spoken lan- guage recognition,","venue":null,"work_id":"21679d91-d9ac-4385-a005-fa2c2a5e460f","year":2021},"citing_paper":{"arxiv_id":"2508.04143","last_updated":"2025-08-06T07:11:36Z","snapshot_observed_at":"2026-08-16T16:30:30.398213Z","submitted_at":"2025-08-06T07:11:36Z","title":"Multilingual Source Tracing of Speech Deepfakes: A First Benchmark","version":1},"reference_index":67,"source":"pdf_text","source_observed_at":"2026-08-06T00:56:06.300770Z"},"links":{"citing_paper":"/paper/2508.04143"},"observation_digest":"sha256:1dcb7ad7579d464602194dfe98d7d76cc260f1b0b1afa4e261faf85ee31766af","observation_id":"849cdd31-960d-46ec-ae65-33a18129af6c","resolution":{"observed_at":"2026-08-06T00:56:08.986663Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T00:56:08.632617Z","title":"Speech recog- nition and keyword spotting for low-resource languages: Babel project research at cued,","venue":null,"work_id":"c6cb5d79-a068-4cef-97ae-58e512830d48","year":2014},"citing_paper":{"arxiv_id":"2508.04143","last_updated":"2025-08-06T07:11:36Z","snapshot_observed_at":"2026-08-16T16:30:30.398213Z","submitted_at":"2025-08-06T07:11:36Z","title":"Multilingual Source Tracing of Speech Deepfakes: A First Benchmark","version":1},"reference_index":68,"source":"pdf_text","source_observed_at":"2026-08-06T00:56:06.417047Z"},"links":{"citing_paper":"/paper/2508.04143"},"observation_digest":"sha256:9041c4803421a308574f76ad265aa8f4f5bc6ee0a156c053f5c39b7a07791801","observation_id":"653873a3-b03b-4db6-a48d-5b608aae17f3","resolution":{"observed_at":"2026-08-06T00:56:08.731722Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T00:56:08.458782Z","title":"wav2vec 2.0: A framework for self-supervised learning of speech represen- tations,","venue":null,"work_id":"324ced74-b536-41e9-ac99-199ea2642863","year":2020},"citing_paper":{"arxiv_id":"2508.04143","last_updated":"2025-08-06T07:11:36Z","snapshot_observed_at":"2026-08-16T16:30:30.398213Z","submitted_at":"2025-08-06T07:11:36Z","title":"Multilingual Source Tracing of Speech Deepfakes: A First Benchmark","version":1},"reference_index":69,"source":"pdf_text","source_observed_at":"2026-08-06T00:56:06.547371Z"},"links":{"citing_paper":"/paper/2508.04143"},"observation_digest":"sha256:6db0788a61c265861e006c0b45f2118d9e041a14d1f9786e79d5e26d7dda5cef","observation_id":"ebc521c7-cc74-475a-bca3-f230ded0ba12","resolution":{"observed_at":"2026-08-06T00:56:08.544693Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T00:56:08.266170Z","title":"Lib- rispeech: An asr corpus based on public domain audio books,","venue":null,"work_id":"2b8755ac-7cf7-4b5f-be59-a61eccc72109","year":2015},"citing_paper":{"arxiv_id":"2508.04143","last_updated":"2025-08-06T07:11:36Z","snapshot_observed_at":"2026-08-16T16:30:30.398213Z","submitted_at":"2025-08-06T07:11:36Z","title":"Multilingual Source Tracing of Speech Deepfakes: A First Benchmark","version":1},"reference_index":70,"source":"pdf_text","source_observed_at":"2026-08-06T00:56:06.654116Z"},"links":{"citing_paper":"/paper/2508.04143"},"observation_digest":"sha256:0a7fd67463f788dd7e89b66326332e3af7e2d8914e69efff26dad0edb2a7d596","observation_id":"2fbbd414-1fdf-4d6a-9016-347bed2e2c9e","resolution":{"observed_at":"2026-08-06T00:56:08.355635Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T00:56:08.097061Z","title":"Towards generalisable and calibrated audio deepfake detection with self-supervised represen- tations,","venue":null,"work_id":"3f315deb-8ebe-4b50-a53f-0ff13799be24","year":2024},"citing_paper":{"arxiv_id":"2508.04143","last_updated":"2025-08-06T07:11:36Z","snapshot_observed_at":"2026-08-16T16:30:30.398213Z","submitted_at":"2025-08-06T07:11:36Z","title":"Multilingual Source Tracing of Speech Deepfakes: A First Benchmark","version":1},"reference_index":71,"source":"pdf_text","source_observed_at":"2026-08-06T00:56:06.799036Z"},"links":{"citing_paper":"/paper/2508.04143"},"observation_digest":"sha256:ffec4d0dcf97cfb9e48c3995c57fcf0f79bd9785ab53e2317b2e1633abeeceb1","observation_id":"52fd4e74-5343-4c5d-9f01-c63832aa2062","resolution":{"observed_at":"2026-08-06T00:56:08.176258Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T00:56:07.944310Z","title":"Unlocking the full potential of separa- ble convolutions on tensor cores,","venue":null,"work_id":"251f6db6-7493-4374-bdd1-da11217f350e","year":2025},"citing_paper":{"arxiv_id":"2508.04143","last_updated":"2025-08-06T07:11:36Z","snapshot_observed_at":"2026-08-16T16:30:30.398213Z","submitted_at":"2025-08-06T07:11:36Z","title":"Multilingual Source Tracing of Speech Deepfakes: A First Benchmark","version":1},"reference_index":73,"source":"pdf_text","source_observed_at":"2026-08-06T00:56:07.006881Z"},"links":{"citing_paper":"/paper/2508.04143"},"observation_digest":"sha256:7892c55934a0972fb4e23a6a73be312dc71397f3afe5aca052d315bac3a4e86c","observation_id":"3b6a9171-82e2-4b3f-9907-dac1fada41bf","resolution":{"observed_at":"2026-08-06T00:56:08.027260Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"2501.09444","doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T00:56:07.408438Z","title":"Available: https://arxiv.org/abs/2501.09444","venue":null,"work_id":"7b1fedea-96b9-4f6c-b572-36209c264df9","year":null},"citing_paper":{"arxiv_id":"2508.04143","last_updated":"2025-08-06T07:11:36Z","snapshot_observed_at":"2026-08-16T16:30:30.398213Z","submitted_at":"2025-08-06T07:11:36Z","title":"Multilingual Source Tracing of Speech Deepfakes: A First Benchmark","version":1},"reference_index":2025,"source":"pdf_text","source_observed_at":"2026-08-06T00:56:03.460432Z"},"links":{"citing_paper":"/paper/2508.04143"},"observation_digest":"sha256:6b7bcab6cb34716f928a02a1538806aa33e3b08b5059c643a3963a5afc2c4af7","observation_id":"5966257d-e303-4ecc-a9bd-047f8192b98a","resolution":{"observed_at":"2026-08-06T00:56:07.497074Z","resolver_source":"raw_fallback","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}}],"paper":{"arxiv_id":"2508.04143","last_updated":"2025-08-06T07:11:36Z","latest_version":1,"primary_category":"eess.AS","snapshot_observed_at":"2026-08-16T16:30:30.398213Z","submitted_at":"2025-08-06T07:11:36Z","title":"Multilingual Source Tracing of Speech Deepfakes: A First Benchmark"},"reference_resolution":{"displayed":73,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":10,"verified_exact":3,"verified_fuzzy":60},"total_outbound_references":73},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"thesis":"As of 16 August 2026, this Paper Citation Record lists 73 of 73 outbound references and 4 inbound Pith citation observations for arXiv:2508.04143."}