{"as_of":"2026-08-19T05:22:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:5bfb14f58c1c074364be2c07cb59a88a25845b2dd3c65d7377e057ddd0718a1b","coverage":[{"denominator":26,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":26,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-07T11:55:23.673253Z","state":"measured"},{"denominator":26,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":26,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-18T06:34:40.430872+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2506.01157/citation-record","integrity":"/paper/2506.01157/integrity","json":"/paper/2506.01157/citation-record.json","paper":"/paper/2506.01157"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:55:25.111604Z","title":"ASVspoof 2015: The first automatic speaker verification spoofing and countermeasures challenge,","venue":null,"work_id":"82bd4ea7-41bd-47d0-8f1b-a4a2536f5320","year":2015},"citing_paper":{"arxiv_id":"2506.01157","last_updated":"2025-06-01T20:32:10Z","snapshot_observed_at":"2026-08-18T03:48:15.291831Z","submitted_at":"2025-06-01T20:32:10Z","title":"Source Tracing of Synthetic Speech Systems Through Paralinguistic Pre-Trained Representations","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-07T11:55:21.097775Z"},"links":{"citing_paper":"/paper/2506.01157"},"observation_digest":"sha256:5f58cd49249197908bd37df6ccb8cd5842b6f623aa3b2031925ed2153c69dd7f","observation_id":"e8c5de60-9c7c-42df-90dc-b58944a8e9c8","resolution":{"observed_at":"2026-08-07T11:55:25.226914Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:55:24.853480Z","title":"ASVspoof 2019: Future horizons in spoofed and fake audio detec- tion,","venue":null,"work_id":"9cd88a71-7938-43b1-9cbd-a5fc2f0bc4e2","year":2019},"citing_paper":{"arxiv_id":"2506.01157","last_updated":"2025-06-01T20:32:10Z","snapshot_observed_at":"2026-08-18T03:48:15.291831Z","submitted_at":"2025-06-01T20:32:10Z","title":"Source Tracing of Synthetic Speech Systems Through Paralinguistic Pre-Trained Representations","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-07T11:55:21.208642Z"},"links":{"citing_paper":"/paper/2506.01157"},"observation_digest":"sha256:d46833446a05b638623bb0bc89f98fa0604d12491c33129fcc8f570ad654c25c","observation_id":"50826cde-30c5-4321-9afc-c4e897365338","resolution":{"observed_at":"2026-08-07T11:55:24.975348Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:55:21.346905Z","title":"Aasist: Audio anti-spoofing using integrated spectro-temporal graph attention networks,","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2506.01157","last_updated":"2025-06-01T20:32:10Z","snapshot_observed_at":"2026-08-18T03:48:15.291831Z","submitted_at":"2025-06-01T20:32:10Z","title":"Source Tracing of Synthetic Speech Systems Through Paralinguistic Pre-Trained Representations","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-07T11:55:21.346905Z"},"links":{"citing_paper":"/paper/2506.01157"},"observation_digest":"sha256:9bd76cb8019fdbb334c02aee6a3f7a5cc2fc4063d016c9ae31ffd6e0cabf16e9","observation_id":"05d4e68b-d85e-42ad-a45d-4abe950d70ab","resolution":{"observed_at":"2026-08-07T11:55:21.346905Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:55:24.732547Z","title":"The vicomtech audio deepfake detection system based on wav2vec2 for the 2022 add challenge,","venue":null,"work_id":"576e0c30-c9f5-48b6-93ec-280c696aa70e","year":2022},"citing_paper":{"arxiv_id":"2506.01157","last_updated":"2025-06-01T20:32:10Z","snapshot_observed_at":"2026-08-18T03:48:15.291831Z","submitted_at":"2025-06-01T20:32:10Z","title":"Source Tracing of Synthetic Speech Systems Through Paralinguistic Pre-Trained Representations","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-07T11:55:21.487980Z"},"links":{"citing_paper":"/paper/2506.01157"},"observation_digest":"sha256:5ee11146017c6b49a9a2148c45874e940f7532a232b669f6a8557b69131e6ef4","observation_id":"0ad68cd1-6c78-43de-b91d-69418c3dad12","resolution":{"observed_at":"2026-08-07T11:55:24.760439Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:55:24.658956Z","title":"Improved deepfake detection using whisper features,","venue":null,"work_id":"4e261c48-3e17-4823-ba82-c9037d93fb46","year":2023},"citing_paper":{"arxiv_id":"2506.01157","last_updated":"2025-06-01T20:32:10Z","snapshot_observed_at":"2026-08-18T03:48:15.291831Z","submitted_at":"2025-06-01T20:32:10Z","title":"Source Tracing of Synthetic Speech Systems Through Paralinguistic Pre-Trained Representations","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-07T11:55:21.621763Z"},"links":{"citing_paper":"/paper/2506.01157"},"observation_digest":"sha256:39a54465e23d194db6918107d7d2bb052f89aa6c600c6a708c0bfd2941cf4d16","observation_id":"c84b8f2d-0c7d-4437-bb90-c03431785f0b","resolution":{"observed_at":"2026-08-07T11:55:24.683920Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:55:24.597116Z","title":"Audio deep- fake detection with self-supervised wavlm and multi-fusion attentive classifier,","venue":null,"work_id":"84ac9888-acae-435a-b512-33b436d9c589","year":2024},"citing_paper":{"arxiv_id":"2506.01157","last_updated":"2025-06-01T20:32:10Z","snapshot_observed_at":"2026-08-18T03:48:15.291831Z","submitted_at":"2025-06-01T20:32:10Z","title":"Source Tracing of Synthetic Speech Systems Through Paralinguistic Pre-Trained Representations","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-07T11:55:21.768608Z"},"links":{"citing_paper":"/paper/2506.01157"},"observation_digest":"sha256:7b9cb38cf50af06a1b0c672d4d059b92da55c2396207cbd8fe23726991d4a5d6","observation_id":"c49f75c2-f9b7-4f24-bcfd-aecea8a65c07","resolution":{"observed_at":"2026-08-07T11:55:24.617301Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:55:24.547891Z","title":"An initial investigation for detecting vocoder fingerprints of fake audio,","venue":null,"work_id":"b31e6006-b3ba-4166-a416-f09ade9c391b","year":2022},"citing_paper":{"arxiv_id":"2506.01157","last_updated":"2025-06-01T20:32:10Z","snapshot_observed_at":"2026-08-18T03:48:15.291831Z","submitted_at":"2025-06-01T20:32:10Z","title":"Source Tracing of Synthetic Speech Systems Through Paralinguistic Pre-Trained Representations","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-07T11:55:21.955676Z"},"links":{"citing_paper":"/paper/2506.01157"},"observation_digest":"sha256:87393f3420afcca90069dc62df9d02b4a668f357a0bd422a5b24e843942a0a8e","observation_id":"8babd6d2-a3ad-4d3d-8c83-767892f362a9","resolution":{"observed_at":"2026-08-07T11:55:24.562905Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2309.06780","last_updated":"2024-06-15T13:16:20Z","snapshot_observed_at":"2026-08-19T01:06:11.134507Z","submitted_at":"2023-09-13T08:06:43Z","title":"Distinguishing Neural Speech Synthesis Models Through Fingerprints in Speech Waveforms","version":2},"cited_work":{"arxiv_id":"2309.06780","doi":null,"metadata_source":"pith","pith_arxiv_id":"2309.06780","snapshot_observed_at":"2026-08-07T11:55:23.782779Z","title":"Distinguishing Neural Speech Synthesis Models Through Fingerprints in Speech Waveforms","venue":"cs.SD","work_id":"f6573f43-7e46-4635-b804-d7532608e0e5","year":2023},"citing_paper":{"arxiv_id":"2506.01157","last_updated":"2025-06-01T20:32:10Z","snapshot_observed_at":"2026-08-18T03:48:15.291831Z","submitted_at":"2025-06-01T20:32:10Z","title":"Source Tracing of Synthetic Speech Systems Through Paralinguistic Pre-Trained Representations","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-07T11:55:22.159586Z"},"links":{"cited_paper":"/paper/2309.06780","citing_paper":"/paper/2506.01157"},"observation_digest":"sha256:fc4aec25dc531f18be00cfdac77e62b774f28143d511c1c95b794b7074431bd6","observation_id":"7a61ba67-5711-4ac8-9536-4b8f72309ab6","resolution":{"observed_at":"2026-08-07T11:55:23.799933Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:55:24.445780Z","title":"Source tracing: Detecting voice spoofing,","venue":null,"work_id":"2b8ace02-9ad0-4bbf-b7ed-8cc728379a9a","year":2022},"citing_paper":{"arxiv_id":"2506.01157","last_updated":"2025-06-01T20:32:10Z","snapshot_observed_at":"2026-08-18T03:48:15.291831Z","submitted_at":"2025-06-01T20:32:10Z","title":"Source Tracing of Synthetic Speech Systems Through Paralinguistic Pre-Trained Representations","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-07T11:55:22.265161Z"},"links":{"citing_paper":"/paper/2506.01157"},"observation_digest":"sha256:c9f98775019d262f6f4bf989cece5356555cd479baca9a65a6aec2cf71f08e9d","observation_id":"29f31988-85b7-450d-b394-b3a352b6ba7b","resolution":{"observed_at":"2026-08-07T11:55:24.498881Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:55:24.379389Z","title":"Source tracing of audio deepfake systems,","venue":null,"work_id":"7213bce5-3535-4375-b24d-b1519618518f","year":2024},"citing_paper":{"arxiv_id":"2506.01157","last_updated":"2025-06-01T20:32:10Z","snapshot_observed_at":"2026-08-18T03:48:15.291831Z","submitted_at":"2025-06-01T20:32:10Z","title":"Source Tracing of Synthetic Speech Systems Through Paralinguistic Pre-Trained Representations","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-07T11:55:22.381459Z"},"links":{"citing_paper":"/paper/2506.01157"},"observation_digest":"sha256:e3396307098a682753ca57ba51e7d91bf675bf4e642bbaa2da224f94c7a5c2fb","observation_id":"c3b79d0d-c61e-4d81-876e-0de91bfee75e","resolution":{"observed_at":"2026-08-07T11:55:24.407446Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2208.10489","last_updated":"2024-11-17T09:12:11Z","snapshot_observed_at":"2026-08-16T16:37:57.079009Z","submitted_at":"2022-08-21T05:15:40Z","title":"Audio Deepfake Attribution: An Initial Dataset and Investigation","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2208.10489","snapshot_observed_at":"2026-08-07T11:55:22.507284Z","title":"Audio deepfake attribution: An initial dataset and investigation,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.01157","last_updated":"2025-06-01T20:32:10Z","snapshot_observed_at":"2026-08-18T03:48:15.291831Z","submitted_at":"2025-06-01T20:32:10Z","title":"Source Tracing of Synthetic Speech Systems Through Paralinguistic Pre-Trained Representations","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-07T11:55:22.507284Z"},"links":{"cited_paper":"/paper/2208.10489","citing_paper":"/paper/2506.01157"},"observation_digest":"sha256:782fa059ded1cefd00c00d4a737115b1d5b6e071ebb2a7d4d8df65695e05c4ff","observation_id":"7d2e7db4-4c88-4ed0-ae1f-26af2710f8c5","resolution":{"observed_at":"2026-08-07T11:55:22.507284Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:55:24.318554Z","title":"Attribution of diffusion based deepfake speech generators,","venue":null,"work_id":"338e71ff-cf62-4665-8317-3e3f7fc6e82d","year":2024},"citing_paper":{"arxiv_id":"2506.01157","last_updated":"2025-06-01T20:32:10Z","snapshot_observed_at":"2026-08-18T03:48:15.291831Z","submitted_at":"2025-06-01T20:32:10Z","title":"Source Tracing of Synthetic Speech Systems Through Paralinguistic Pre-Trained Representations","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-07T11:55:22.636558Z"},"links":{"citing_paper":"/paper/2506.01157"},"observation_digest":"sha256:4a509dc5aed1edc8d35dd463eb5d17ac1f9e6986e10a45ee69d1da2333b94cf0","observation_id":"e011e271-34f0-4c39-b2f2-fae66a540ba9","resolution":{"observed_at":"2026-08-07T11:55:24.341197Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2412.17796","last_updated":"2024-12-23T18:53:15Z","snapshot_observed_at":"2026-08-18T03:47:42.420036Z","submitted_at":"2024-12-23T18:53:15Z","title":"Investigating Prosodic Signatures via Speech Pre-Trained Models for Audio Deepfake Source Attribution","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2412.17796","snapshot_observed_at":"2026-08-07T11:55:22.751688Z","title":"Investigating prosodic signatures via speech pre-trained models for audio deepfake source attribution,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.01157","last_updated":"2025-06-01T20:32:10Z","snapshot_observed_at":"2026-08-18T03:48:15.291831Z","submitted_at":"2025-06-01T20:32:10Z","title":"Source Tracing of Synthetic Speech Systems Through Paralinguistic Pre-Trained Representations","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-07T11:55:22.751688Z"},"links":{"cited_paper":"/paper/2412.17796","citing_paper":"/paper/2506.01157"},"observation_digest":"sha256:5978ce0c1ffcfd1274da7a769773b6eff5806ac07738ad827809d1ec08c0b0a1","observation_id":"bdc98a69-0f02-49e3-ac08-6914e78cf405","resolution":{"observed_at":"2026-08-07T11:55:22.751688Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:55:24.238471Z","title":"Trillsson: Distilled universal paralinguis- tic speech representations,","venue":null,"work_id":"76ada744-e72c-4fc5-80a6-d2d66013a99a","year":2022},"citing_paper":{"arxiv_id":"2506.01157","last_updated":"2025-06-01T20:32:10Z","snapshot_observed_at":"2026-08-18T03:48:15.291831Z","submitted_at":"2025-06-01T20:32:10Z","title":"Source Tracing of Synthetic Speech Systems Through Paralinguistic Pre-Trained Representations","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-07T11:55:22.860886Z"},"links":{"citing_paper":"/paper/2506.01157"},"observation_digest":"sha256:9bcbc0a7c912e8df0aafc191e0724fe07fb57b14ccd4622c8f48704c0af10ab7","observation_id":"187d782f-4e62-4dc6-bddb-8a506924e2e5","resolution":{"observed_at":"2026-08-07T11:55:24.274659Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:55:24.166841Z","title":"Heterogeneity over homogeneity: Investigating multilingual speech pre-trained models for detecting audio deepfake,","venue":null,"work_id":"fea60d1c-ba69-4a77-b1e4-4a1ea714acf7","year":2024},"citing_paper":{"arxiv_id":"2506.01157","last_updated":"2025-06-01T20:32:10Z","snapshot_observed_at":"2026-08-18T03:48:15.291831Z","submitted_at":"2025-06-01T20:32:10Z","title":"Source Tracing of Synthetic Speech Systems Through Paralinguistic Pre-Trained Representations","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-07T11:55:22.988460Z"},"links":{"citing_paper":"/paper/2506.01157"},"observation_digest":"sha256:5a3a2e233ab09b2ac2c5ddcfabf4006bffd4cffd8eda324c3681d190f192b79b","observation_id":"39ea72bb-b947-45dc-a6ea-0b1d988d6322","resolution":{"observed_at":"2026-08-07T11:55:24.196081Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:55:24.115175Z","title":"Investigation of ensemble of self-supervised models for speech emotion recognition,","venue":null,"work_id":"6cc314b9-cc86-42b8-8775-5c9977de7051","year":2023},"citing_paper":{"arxiv_id":"2506.01157","last_updated":"2025-06-01T20:32:10Z","snapshot_observed_at":"2026-08-18T03:48:15.291831Z","submitted_at":"2025-06-01T20:32:10Z","title":"Source Tracing of Synthetic Speech Systems Through Paralinguistic Pre-Trained Representations","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-07T11:55:23.130025Z"},"links":{"citing_paper":"/paper/2506.01157"},"observation_digest":"sha256:b145d43d72b90fd0f70e5943013c674a199818c7c7a14327268c2f2d1b4e49ba","observation_id":"087d5957-744c-4c38-95c9-1864d87694c0","resolution":{"observed_at":"2026-08-07T11:55:24.135591Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:55:23.304269Z","title":"wav2vec 2.0: A framework for self-supervised learning of speech representations,","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2506.01157","last_updated":"2025-06-01T20:32:10Z","snapshot_observed_at":"2026-08-18T03:48:15.291831Z","submitted_at":"2025-06-01T20:32:10Z","title":"Source Tracing of Synthetic Speech Systems Through Paralinguistic Pre-Trained Representations","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-07T11:55:23.304269Z"},"links":{"citing_paper":"/paper/2506.01157"},"observation_digest":"sha256:75be7a9d1cc682efdff6c84951e77a05551e97b2afb3715be07a7e12e2a5d802","observation_id":"6d6825af-4381-490e-8c0b-36d60019be5d","resolution":{"observed_at":"2026-08-07T11:55:23.304269Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:55:23.464646Z","title":"Wavlm: Large-scale self-supervised pre- training for full stack speech processing,","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2506.01157","last_updated":"2025-06-01T20:32:10Z","snapshot_observed_at":"2026-08-18T03:48:15.291831Z","submitted_at":"2025-06-01T20:32:10Z","title":"Source Tracing of Synthetic Speech Systems Through Paralinguistic Pre-Trained Representations","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-07T11:55:23.464646Z"},"links":{"citing_paper":"/paper/2506.01157"},"observation_digest":"sha256:5051fcaacc2b69c749c0c6c896bb099dbe623ef06f899c6b229d47553b49ad7a","observation_id":"e29f74af-be0b-4127-bc27-bade42cefa7c","resolution":{"observed_at":"2026-08-07T11:55:23.464646Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:55:24.037829Z","title":"Unispeech-sat: Universal speech representation learning with speaker aware pre-training,","venue":null,"work_id":"504faed7-e4d4-4a2f-9541-fde4d57a2e07","year":2022},"citing_paper":{"arxiv_id":"2506.01157","last_updated":"2025-06-01T20:32:10Z","snapshot_observed_at":"2026-08-18T03:48:15.291831Z","submitted_at":"2025-06-01T20:32:10Z","title":"Source Tracing of Synthetic Speech Systems Through Paralinguistic Pre-Trained Representations","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-07T11:55:23.572857Z"},"links":{"citing_paper":"/paper/2506.01157"},"observation_digest":"sha256:e3bc479bf398b90371fad76e38be2014a90b75b5120cd9ba60f3b7ca002ddaec","observation_id":"1753e292-baf5-4164-9fe6-35e8c806b4d9","resolution":{"observed_at":"2026-08-07T11:55:24.064168Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:55:23.973881Z","title":"Xls-r: Self-supervised cross-lingual speech representation learning at scale,","venue":null,"work_id":"13dacdb9-4338-48a0-8f62-75b37efd6af2","year":2022},"citing_paper":{"arxiv_id":"2506.01157","last_updated":"2025-06-01T20:32:10Z","snapshot_observed_at":"2026-08-18T03:48:15.291831Z","submitted_at":"2025-06-01T20:32:10Z","title":"Source Tracing of Synthetic Speech Systems Through Paralinguistic Pre-Trained Representations","version":1},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-07T11:55:23.607147Z"},"links":{"citing_paper":"/paper/2506.01157"},"observation_digest":"sha256:af71d83cd56e9c6d320d63768651fe101ff7268a4b3aac6b09e534d09d860ca6","observation_id":"1ed50c70-509f-4f25-8f41-c4fafef3b5e8","resolution":{"observed_at":"2026-08-07T11:55:23.996634Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:55:23.618210Z","title":"Robust speech recognition via large-scale weak supervi- sion,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.01157","last_updated":"2025-06-01T20:32:10Z","snapshot_observed_at":"2026-08-18T03:48:15.291831Z","submitted_at":"2025-06-01T20:32:10Z","title":"Source Tracing of Synthetic Speech Systems Through Paralinguistic Pre-Trained Representations","version":1},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-07T11:55:23.618210Z"},"links":{"citing_paper":"/paper/2506.01157"},"observation_digest":"sha256:a6d30658de02aef5b63ebb64dfc180d5cd290b1983a0a489dd0c16eef8213dee","observation_id":"5ff1adfd-8fc9-4eec-b481-001c2194bd7c","resolution":{"observed_at":"2026-08-07T11:55:23.618210Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:55:23.630128Z","title":"Scaling speech technology to 1,000+ languages,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.01157","last_updated":"2025-06-01T20:32:10Z","snapshot_observed_at":"2026-08-18T03:48:15.291831Z","submitted_at":"2025-06-01T20:32:10Z","title":"Source Tracing of Synthetic Speech Systems Through Paralinguistic Pre-Trained Representations","version":1},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-07T11:55:23.630128Z"},"links":{"citing_paper":"/paper/2506.01157"},"observation_digest":"sha256:4fcd90a7f78858bb5a1e7e6a49607348dd1fa385948d43e92ce611fb5b011781","observation_id":"19e0b6e1-1644-4cc7-a4ea-ad9c742e3be4","resolution":{"observed_at":"2026-08-07T11:55:23.630128Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:55:23.911786Z","title":"X-vectors: Robust dnn embeddings for speaker recognition,","venue":null,"work_id":"d3495209-8db5-42c2-b2c8-9c8dc825ba85","year":2018},"citing_paper":{"arxiv_id":"2506.01157","last_updated":"2025-06-01T20:32:10Z","snapshot_observed_at":"2026-08-18T03:48:15.291831Z","submitted_at":"2025-06-01T20:32:10Z","title":"Source Tracing of Synthetic Speech Systems Through Paralinguistic Pre-Trained Representations","version":1},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-07T11:55:23.639343Z"},"links":{"citing_paper":"/paper/2506.01157"},"observation_digest":"sha256:b0956741fcff8b06455e140af7e88bfa07ee35e0f0848b4a4135ff01104e17b4","observation_id":"d275637a-d910-41dd-9f7c-57071994fb9c","resolution":{"observed_at":"2026-08-07T11:55:23.921537Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:55:23.879703Z","title":"Ecapa-tdnn: Emphasized channel attention, propagation and aggregation in tdnn based speaker verification,","venue":null,"work_id":"fd5d3a20-9b3d-4685-b6bb-942b0f19cf2d","year":2020},"citing_paper":{"arxiv_id":"2506.01157","last_updated":"2025-06-01T20:32:10Z","snapshot_observed_at":"2026-08-18T03:48:15.291831Z","submitted_at":"2025-06-01T20:32:10Z","title":"Source Tracing of Synthetic Speech Systems Through Paralinguistic Pre-Trained Representations","version":1},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-07T11:55:23.649515Z"},"links":{"citing_paper":"/paper/2506.01157"},"observation_digest":"sha256:cce4166c49efa6de034a83a3728a59fc1159be697b4992ff13011eb5d8095a28","observation_id":"ce4dc26a-d000-48e4-90bc-1952f57f75c7","resolution":{"observed_at":"2026-08-07T11:55:23.891046Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:55:23.847684Z","title":"Asvspoof 2019: A large-scale public database of synthesized, converted and replayed speech,","venue":null,"work_id":"38cf4f56-475b-4321-bbd8-aa39edb60caf","year":2019},"citing_paper":{"arxiv_id":"2506.01157","last_updated":"2025-06-01T20:32:10Z","snapshot_observed_at":"2026-08-18T03:48:15.291831Z","submitted_at":"2025-06-01T20:32:10Z","title":"Source Tracing of Synthetic Speech Systems Through Paralinguistic Pre-Trained Representations","version":1},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-08-07T11:55:23.660637Z"},"links":{"citing_paper":"/paper/2506.01157"},"observation_digest":"sha256:c6efaeacbf63c7bb533a429fe6f421811df417442090062b9475682e587a3e9f","observation_id":"7990be98-3eac-4838-9b77-f7c58fe97f88","resolution":{"observed_at":"2026-08-07T11:55:23.856699Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:55:23.820687Z","title":"Cfad: A chinese dataset for fake audio detection,","venue":null,"work_id":"7b4a4d92-9b93-4bcd-ac3e-141111dabd68","year":2024},"citing_paper":{"arxiv_id":"2506.01157","last_updated":"2025-06-01T20:32:10Z","snapshot_observed_at":"2026-08-18T03:48:15.291831Z","submitted_at":"2025-06-01T20:32:10Z","title":"Source Tracing of Synthetic Speech Systems Through Paralinguistic Pre-Trained Representations","version":1},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-08-07T11:55:23.673253Z"},"links":{"citing_paper":"/paper/2506.01157"},"observation_digest":"sha256:cc34017c20c8c58fd1e488f6c573e68598def5885fa42893d7a1520cdd73fd23","observation_id":"1626e9b5-5303-42ee-95c1-f94a00e6c7e9","resolution":{"observed_at":"2026-08-07T11:55:23.831121Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}}],"paper":{"arxiv_id":"2506.01157","last_updated":"2025-06-01T20:32:10Z","latest_version":1,"primary_category":"eess.AS","snapshot_observed_at":"2026-08-18T03:48:15.291831Z","submitted_at":"2025-06-01T20:32:10Z","title":"Source Tracing of Synthetic Speech Systems Through Paralinguistic Pre-Trained Representations"},"reference_resolution":{"displayed":26,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":7,"verified_exact":1,"verified_fuzzy":18},"total_outbound_references":26},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"thesis":"As of 19 August 2026, this Paper Citation Record lists 26 of 26 outbound references and 0 inbound Pith citation observations for arXiv:2506.01157."}