{"as_of":"2026-08-12T21:42:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:04a552c8778bb868c79c7113b1121f7191d9e15094427239ad07b22bb0e3ec86","coverage":[{"denominator":40,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":40,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-10T21:21:12.169911Z","state":"measured"},{"denominator":40,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":40,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-12T06:34:41.77262+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2501.05127/citation-record","integrity":"/paper/2501.05127/integrity","json":"/paper/2501.05127/citation-record.json","paper":"/paper/2501.05127"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T21:21:12.787218Z","title":"Speaker recognition by machines and humans: A tutorial review,","venue":null,"work_id":"79bf6bd1-6111-4e62-88b7-3be366c8e33c","year":2015},"citing_paper":{"arxiv_id":"2501.05127","last_updated":"2025-01-09T10:30:58Z","snapshot_observed_at":"2026-08-10T22:40:48.098162Z","submitted_at":"2025-01-09T10:30:58Z","title":"DiffAttack: Diffusion-based Timbre-reserved Adversarial Attack in Speaker Identification","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-10T21:21:11.981181Z"},"links":{"citing_paper":"/paper/2501.05127"},"observation_digest":"sha256:426d2bf25ec2ee2891442e362d5f371501b09ef330815cf5966e794b6edf943b","observation_id":"8cb9c6d8-7def-4d0a-9a98-deea8d6a67c6","resolution":{"observed_at":"2026-08-10T21:21:12.791957Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T21:21:12.771671Z","title":"Robust text-independent speaker iden- tification using Gaussian mixture speaker models,","venue":null,"work_id":"1613e865-785f-4ec5-85d1-1677dbbaaa84","year":1995},"citing_paper":{"arxiv_id":"2501.05127","last_updated":"2025-01-09T10:30:58Z","snapshot_observed_at":"2026-08-10T22:40:48.098162Z","submitted_at":"2025-01-09T10:30:58Z","title":"DiffAttack: Diffusion-based Timbre-reserved Adversarial Attack in Speaker Identification","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-10T21:21:11.986947Z"},"links":{"citing_paper":"/paper/2501.05127"},"observation_digest":"sha256:e3ed664457ad4001e6d484f22b15b0abb2fcf92284d10aeee6662d1212bc44f1","observation_id":"f5cdb4af-61f8-4ba4-ae2c-faa5ca648449","resolution":{"observed_at":"2026-08-10T21:21:12.776591Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T21:21:12.757107Z","title":"Detecting converted speech and natural speech for anti-spoofing attack in speaker recognition,","venue":null,"work_id":"5a49ae82-bb71-479d-aea8-af5acd10e67d","year":2012},"citing_paper":{"arxiv_id":"2501.05127","last_updated":"2025-01-09T10:30:58Z","snapshot_observed_at":"2026-08-10T22:40:48.098162Z","submitted_at":"2025-01-09T10:30:58Z","title":"DiffAttack: Diffusion-based Timbre-reserved Adversarial Attack in Speaker Identification","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-10T21:21:11.992159Z"},"links":{"citing_paper":"/paper/2501.05127"},"observation_digest":"sha256:17571133b6e9e749b11c63fe565f5b2a7e90c78b21c4f84daf0f9ff7c914368d","observation_id":"70a87bd5-e4e2-4087-979e-cf57c595d296","resolution":{"observed_at":"2026-08-10T21:21:12.762012Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T21:21:12.742307Z","title":"Spoofing and countermeasures for speaker verification: a survey,","venue":null,"work_id":"921c0e0b-a582-41c1-9b0b-e798be5e1cc0","year":2015},"citing_paper":{"arxiv_id":"2501.05127","last_updated":"2025-01-09T10:30:58Z","snapshot_observed_at":"2026-08-10T22:40:48.098162Z","submitted_at":"2025-01-09T10:30:58Z","title":"DiffAttack: Diffusion-based Timbre-reserved Adversarial Attack in Speaker Identification","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-10T21:21:11.997213Z"},"links":{"citing_paper":"/paper/2501.05127"},"observation_digest":"sha256:defec9bc0ce1514d16105e2de67daacb39c8e3ca6f0d62728d1640106a32eb98","observation_id":"9ee9a818-4b68-4aaa-b4fc-c45bc492759a","resolution":{"observed_at":"2026-08-10T21:21:12.747138Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T21:21:12.725899Z","title":"ASVspoof: the automatic speaker verification spoofing and countermeasures challenge,","venue":null,"work_id":"2d375468-82c7-47b8-a2ef-73e21ee00c5e","year":2017},"citing_paper":{"arxiv_id":"2501.05127","last_updated":"2025-01-09T10:30:58Z","snapshot_observed_at":"2026-08-10T22:40:48.098162Z","submitted_at":"2025-01-09T10:30:58Z","title":"DiffAttack: Diffusion-based Timbre-reserved Adversarial Attack in Speaker Identification","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-10T21:21:12.002327Z"},"links":{"citing_paper":"/paper/2501.05127"},"observation_digest":"sha256:f18c849275d3aac5a7fb87460bdb38eadbe1c91b9d853b1dfddc85229359514c","observation_id":"208a9037-4fe3-457e-89b4-0022830c2961","resolution":{"observed_at":"2026-08-10T21:21:12.730987Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1412.6572","last_updated":"2015-03-20T20:19:16Z","snapshot_observed_at":"2026-08-12T17:13:46.394331Z","submitted_at":"2014-12-20T01:17:12Z","title":"Explaining and Harnessing Adversarial Examples","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1412.6572","snapshot_observed_at":"2026-08-10T21:21:12.007286Z","title":"Explaining and harnessing adversarial examples,","venue":null,"work_id":null,"year":2014},"citing_paper":{"arxiv_id":"2501.05127","last_updated":"2025-01-09T10:30:58Z","snapshot_observed_at":"2026-08-10T22:40:48.098162Z","submitted_at":"2025-01-09T10:30:58Z","title":"DiffAttack: Diffusion-based Timbre-reserved Adversarial Attack in Speaker Identification","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-10T21:21:12.007286Z"},"links":{"cited_paper":"/paper/1412.6572","citing_paper":"/paper/2501.05127"},"observation_digest":"sha256:1b74645f8b61cc58a3316b4942079eb065464a1d904c84314c920c3de0212789","observation_id":"123406fe-4ea2-4f76-bec6-488846908c68","resolution":{"observed_at":"2026-08-10T21:21:12.007286Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T21:21:12.711075Z","title":"Towards evaluating the robustness of neural networks,","venue":null,"work_id":"2b35fd19-c672-4362-92f7-6cd3ca00749f","year":2017},"citing_paper":{"arxiv_id":"2501.05127","last_updated":"2025-01-09T10:30:58Z","snapshot_observed_at":"2026-08-10T22:40:48.098162Z","submitted_at":"2025-01-09T10:30:58Z","title":"DiffAttack: Diffusion-based Timbre-reserved Adversarial Attack in Speaker Identification","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-10T21:21:12.012751Z"},"links":{"citing_paper":"/paper/2501.05127"},"observation_digest":"sha256:95feeffb48ed62bec5c8a12a65ac397b9c989bd35a1734748ffb1b29b1d69983","observation_id":"944e9849-2e3f-496d-8e46-93e1aaa0b402","resolution":{"observed_at":"2026-08-10T21:21:12.715884Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1312.6199","last_updated":"2014-02-19T16:33:14Z","snapshot_observed_at":"2026-07-06T03:31:33.797310Z","submitted_at":"2013-12-21T03:36:08Z","title":"Intriguing properties of neural networks","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1312.6199","snapshot_observed_at":"2026-08-10T21:21:12.017242Z","title":"Intriguing properties of neural networks,","venue":null,"work_id":null,"year":2013},"citing_paper":{"arxiv_id":"2501.05127","last_updated":"2025-01-09T10:30:58Z","snapshot_observed_at":"2026-08-10T22:40:48.098162Z","submitted_at":"2025-01-09T10:30:58Z","title":"DiffAttack: Diffusion-based Timbre-reserved Adversarial Attack in Speaker Identification","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-10T21:21:12.017242Z"},"links":{"cited_paper":"/paper/1312.6199","citing_paper":"/paper/2501.05127"},"observation_digest":"sha256:a6729a96988206c462b416d6d53d35726ab4c82e9cc90b3aa7a0acaa05ae6f5b","observation_id":"883e530a-c8d5-4b23-83d9-1d93e91d2003","resolution":{"observed_at":"2026-08-10T21:21:12.017242Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1607.02533","last_updated":"2017-02-11T00:39:39Z","snapshot_observed_at":"2026-07-06T05:02:57.607157Z","submitted_at":"2016-07-08T21:12:11Z","title":"Adversarial examples in the physical world","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1607.02533","snapshot_observed_at":"2026-08-10T21:21:12.022334Z","title":"Adversarial examples in the physical world,","venue":null,"work_id":null,"year":2016},"citing_paper":{"arxiv_id":"2501.05127","last_updated":"2025-01-09T10:30:58Z","snapshot_observed_at":"2026-08-10T22:40:48.098162Z","submitted_at":"2025-01-09T10:30:58Z","title":"DiffAttack: Diffusion-based Timbre-reserved Adversarial Attack in Speaker Identification","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-10T21:21:12.022334Z"},"links":{"cited_paper":"/paper/1607.02533","citing_paper":"/paper/2501.05127"},"observation_digest":"sha256:fd2babbd536fd9579969ebfa2e8efc92e5bb2ca9669ce33e71909d3879f82772","observation_id":"03005af5-ae5b-43a3-99f5-086c9a12bf6f","resolution":{"observed_at":"2026-08-10T21:21:12.022334Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T21:21:12.695711Z","title":"The attacker’s perspective on automatic speaker verification: an overview,","venue":null,"work_id":"10a12fa2-be21-4175-bc35-87f579ed35fb","year":2020},"citing_paper":{"arxiv_id":"2501.05127","last_updated":"2025-01-09T10:30:58Z","snapshot_observed_at":"2026-08-10T22:40:48.098162Z","submitted_at":"2025-01-09T10:30:58Z","title":"DiffAttack: Diffusion-based Timbre-reserved Adversarial Attack in Speaker Identification","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-10T21:21:12.027432Z"},"links":{"citing_paper":"/paper/2501.05127"},"observation_digest":"sha256:c98e317b8075b6f009cda332b2bda9c883fb657eca87db67d0ed844c971b9e14","observation_id":"06408e7e-c9aa-43e7-a682-05e27774206d","resolution":{"observed_at":"2026-08-10T21:21:12.700932Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T21:21:12.680876Z","title":"Fooling end-to-end speaker verification with adversarial examples,","venue":null,"work_id":"be303c9d-0859-4e1a-bdda-5892b4ae3be1","year":2018},"citing_paper":{"arxiv_id":"2501.05127","last_updated":"2025-01-09T10:30:58Z","snapshot_observed_at":"2026-08-10T22:40:48.098162Z","submitted_at":"2025-01-09T10:30:58Z","title":"DiffAttack: Diffusion-based Timbre-reserved Adversarial Attack in Speaker Identification","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-10T21:21:12.032124Z"},"links":{"citing_paper":"/paper/2501.05127"},"observation_digest":"sha256:b9d03761ea6db5f617321fb675aedda0ae22c679f9d2ee31b1a68ac4fb9e2148","observation_id":"6fead255-33a2-4d56-9002-203658bf3272","resolution":{"observed_at":"2026-08-10T21:21:12.685767Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T21:21:12.665842Z","title":"Adversarial regularization for end-to-end robust speaker verification,","venue":null,"work_id":"ef3ecdbc-386a-484e-b6e4-02bb4b8d4ec9","year":2019},"citing_paper":{"arxiv_id":"2501.05127","last_updated":"2025-01-09T10:30:58Z","snapshot_observed_at":"2026-08-10T22:40:48.098162Z","submitted_at":"2025-01-09T10:30:58Z","title":"DiffAttack: Diffusion-based Timbre-reserved Adversarial Attack in Speaker Identification","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-10T21:21:12.036907Z"},"links":{"citing_paper":"/paper/2501.05127"},"observation_digest":"sha256:cdb35c5445ba1c6e2a97f4d906a8fa5a6b3e959358e5d363aa7d99dec8582193","observation_id":"38b27a62-7a5c-4f9e-99c6-2de87590bbee","resolution":{"observed_at":"2026-08-10T21:21:12.670577Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1904.05734","last_updated":"2019-03-18T20:10:13Z","snapshot_observed_at":"2026-08-10T15:17:35.687699Z","submitted_at":"2019-03-18T20:10:13Z","title":"Practical Hidden Voice Attacks against Speech and Speaker Recognition Systems","version":1},"cited_work":{"arxiv_id":"1904.05734","doi":null,"metadata_source":"pith","pith_arxiv_id":"1904.05734","snapshot_observed_at":"2026-08-10T21:21:12.324833Z","title":"Practical Hidden Voice Attacks against Speech and Speaker Recognition Systems","venue":"cs.CR","work_id":"adb72a10-01ea-4279-9700-b5b0ee868dfb","year":2019},"citing_paper":{"arxiv_id":"2501.05127","last_updated":"2025-01-09T10:30:58Z","snapshot_observed_at":"2026-08-10T22:40:48.098162Z","submitted_at":"2025-01-09T10:30:58Z","title":"DiffAttack: Diffusion-based Timbre-reserved Adversarial Attack in Speaker Identification","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-10T21:21:12.041432Z"},"links":{"cited_paper":"/paper/1904.05734","citing_paper":"/paper/2501.05127"},"observation_digest":"sha256:7c65d406a4490195f40ead1b2014f5e75a8e4c5c87124fd03552b1410df950da","observation_id":"fb35ac4b-fa6d-4a49-9c02-ee3792fac764","resolution":{"observed_at":"2026-08-10T21:21:12.331958Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T21:21:12.650309Z","title":"Inaudible adversarial perturbations for targeted attack in speaker recognition,","venue":null,"work_id":"db3cdac5-741d-4f17-bb45-9e7c0746eb9a","year":2020},"citing_paper":{"arxiv_id":"2501.05127","last_updated":"2025-01-09T10:30:58Z","snapshot_observed_at":"2026-08-10T22:40:48.098162Z","submitted_at":"2025-01-09T10:30:58Z","title":"DiffAttack: Diffusion-based Timbre-reserved Adversarial Attack in Speaker Identification","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-10T21:21:12.046376Z"},"links":{"citing_paper":"/paper/2501.05127"},"observation_digest":"sha256:7255dc12152fe8d2e7b67e9bbfd3589b9b21e6bd15b97e9f8076381d62e9b813","observation_id":"5db8824b-e49b-47da-9590-1436fc15db12","resolution":{"observed_at":"2026-08-10T21:21:12.655195Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T21:21:12.635141Z","title":"Universal adversarial perturbations generative network for speaker recognition,","venue":null,"work_id":"64a05836-72f2-4f8c-90e3-93c32a502d43","year":2020},"citing_paper":{"arxiv_id":"2501.05127","last_updated":"2025-01-09T10:30:58Z","snapshot_observed_at":"2026-08-10T22:40:48.098162Z","submitted_at":"2025-01-09T10:30:58Z","title":"DiffAttack: Diffusion-based Timbre-reserved Adversarial Attack in Speaker Identification","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-10T21:21:12.051140Z"},"links":{"citing_paper":"/paper/2501.05127"},"observation_digest":"sha256:fdb02cda2a343ca80b988db15224d9a6d6863d6f44caf9894ba755c8df68843d","observation_id":"4e1cb05a-59a1-433f-8262-3f73c1e66091","resolution":{"observed_at":"2026-08-10T21:21:12.640220Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T21:21:12.618943Z","title":"Real-time, universal, and robust adversarial attacks against speaker recognition systems,","venue":null,"work_id":"44446b32-de15-4de2-b0da-f80fe5fd1eb1","year":2020},"citing_paper":{"arxiv_id":"2501.05127","last_updated":"2025-01-09T10:30:58Z","snapshot_observed_at":"2026-08-10T22:40:48.098162Z","submitted_at":"2025-01-09T10:30:58Z","title":"DiffAttack: Diffusion-based Timbre-reserved Adversarial Attack in Speaker Identification","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-10T21:21:12.055619Z"},"links":{"citing_paper":"/paper/2501.05127"},"observation_digest":"sha256:b0d28245f00177e54e2c79cbe8c4b206a5c7b72d1a9c0dfde92d84c41bde94fa","observation_id":"9e093287-ecac-403d-8ee2-93a1b74dd565","resolution":{"observed_at":"2026-08-10T21:21:12.624403Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T21:21:12.601844Z","title":"Practical adversarial attacks against speaker recognition systems,","venue":null,"work_id":"593b5ae9-98ef-4949-81a1-3330ee955ee2","year":2020},"citing_paper":{"arxiv_id":"2501.05127","last_updated":"2025-01-09T10:30:58Z","snapshot_observed_at":"2026-08-10T22:40:48.098162Z","submitted_at":"2025-01-09T10:30:58Z","title":"DiffAttack: Diffusion-based Timbre-reserved Adversarial Attack in Speaker Identification","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-10T21:21:12.060462Z"},"links":{"citing_paper":"/paper/2501.05127"},"observation_digest":"sha256:7218c9e6cae3fc53483b14b6293b555dab10bfa6bb6aaac7058b3b05d67cd7ab","observation_id":"a8bda6f2-3989-4064-8637-104e00f3bced","resolution":{"observed_at":"2026-08-10T21:21:12.606812Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T21:21:12.586907Z","title":"Adversarial attacks on GMM i-vector based speaker verification systems,","venue":null,"work_id":"07f72a50-bb42-40cc-a068-da9c9b0371ab","year":2020},"citing_paper":{"arxiv_id":"2501.05127","last_updated":"2025-01-09T10:30:58Z","snapshot_observed_at":"2026-08-10T22:40:48.098162Z","submitted_at":"2025-01-09T10:30:58Z","title":"DiffAttack: Diffusion-based Timbre-reserved Adversarial Attack in Speaker Identification","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-10T21:21:12.064859Z"},"links":{"citing_paper":"/paper/2501.05127"},"observation_digest":"sha256:438b90f7fa8a600efef3a258e50588ebf41d1b31e1c958f2b37cfb407c3f3872","observation_id":"a4e54b92-6428-4ce7-9818-ee3cc71dbba7","resolution":{"observed_at":"2026-08-10T21:21:12.591905Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T21:21:12.570308Z","title":"Who is real bob? adversarial attacks on speaker recognition systems,","venue":null,"work_id":"0a48b7d6-cf96-4911-a559-461c8a0f9bc7","year":2021},"citing_paper":{"arxiv_id":"2501.05127","last_updated":"2025-01-09T10:30:58Z","snapshot_observed_at":"2026-08-10T22:40:48.098162Z","submitted_at":"2025-01-09T10:30:58Z","title":"DiffAttack: Diffusion-based Timbre-reserved Adversarial Attack in Speaker Identification","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-10T21:21:12.069415Z"},"links":{"citing_paper":"/paper/2501.05127"},"observation_digest":"sha256:a0940d5516bd7f526243bfff9c9ce0f942d081ce7251346da9b1358f5ab6cefa","observation_id":"9356085f-2c3e-4d31-843b-03569d25e64d","resolution":{"observed_at":"2026-08-10T21:21:12.576380Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T21:21:12.552836Z","title":"Adversarial attack and defense strategies for deep speaker recognition systems,","venue":null,"work_id":"0fa1baf1-f21b-43e3-b995-871054b1740a","year":2021},"citing_paper":{"arxiv_id":"2501.05127","last_updated":"2025-01-09T10:30:58Z","snapshot_observed_at":"2026-08-10T22:40:48.098162Z","submitted_at":"2025-01-09T10:30:58Z","title":"DiffAttack: Diffusion-based Timbre-reserved Adversarial Attack in Speaker Identification","version":1},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-10T21:21:12.074271Z"},"links":{"citing_paper":"/paper/2501.05127"},"observation_digest":"sha256:6f9977266171481c85b3be7f0f7c8e967ae9578c264363993c5fca657f6decce","observation_id":"689f6596-235f-4571-8093-57c6c590fd8c","resolution":{"observed_at":"2026-08-10T21:21:12.557888Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T21:21:12.537013Z","title":"Pseudo-Siamese Net- work based Timbre-reserved Black-box Adversarial Attack in Speaker Identification,","venue":null,"work_id":"3c15daf1-d551-43d6-af70-e83c9f343c52","year":2023},"citing_paper":{"arxiv_id":"2501.05127","last_updated":"2025-01-09T10:30:58Z","snapshot_observed_at":"2026-08-10T22:40:48.098162Z","submitted_at":"2025-01-09T10:30:58Z","title":"DiffAttack: Diffusion-based Timbre-reserved Adversarial Attack in Speaker Identification","version":1},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-10T21:21:12.078574Z"},"links":{"citing_paper":"/paper/2501.05127"},"observation_digest":"sha256:bbb3ef615d8685c5b9f32b1a5e03e6de2d1c0114cd518e59d3cd474660a51269","observation_id":"82a1d5ee-ac37-479a-97b4-22b951fbc58c","resolution":{"observed_at":"2026-08-10T21:21:12.541966Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T21:21:12.083067Z","title":"X-vectors: Robust DNN embeddings for speaker recognition,","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2501.05127","last_updated":"2025-01-09T10:30:58Z","snapshot_observed_at":"2026-08-10T22:40:48.098162Z","submitted_at":"2025-01-09T10:30:58Z","title":"DiffAttack: Diffusion-based Timbre-reserved Adversarial Attack in Speaker Identification","version":1},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-10T21:21:12.083067Z"},"links":{"citing_paper":"/paper/2501.05127"},"observation_digest":"sha256:4b0af2415ac81977b1ae211f5d1e9919ba872f3f30deb91c5d551d8097482a96","observation_id":"69851e4d-be04-4d88-8224-36b3950ee5c0","resolution":{"observed_at":"2026-08-10T21:21:12.083067Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T21:21:12.511178Z","title":"Generalized end-to- end loss for speaker verification,","venue":null,"work_id":"d97f4ec0-5bc5-41d6-a581-874171245893","year":2018},"citing_paper":{"arxiv_id":"2501.05127","last_updated":"2025-01-09T10:30:58Z","snapshot_observed_at":"2026-08-10T22:40:48.098162Z","submitted_at":"2025-01-09T10:30:58Z","title":"DiffAttack: Diffusion-based Timbre-reserved Adversarial Attack in Speaker Identification","version":1},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-10T21:21:12.087851Z"},"links":{"citing_paper":"/paper/2501.05127"},"observation_digest":"sha256:336d826155064337e21ff58dfed965ff00ae9cf0a3a0a2ec068ee31c248fdfe0","observation_id":"d9cf3b7a-ce7b-483b-9ac3-6b60cad334b5","resolution":{"observed_at":"2026-08-10T21:21:12.516168Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2005.07143","last_updated":"2020-08-10T13:50:24Z","snapshot_observed_at":"2026-08-07T15:21:18.262728Z","submitted_at":"2020-05-14T17:02:15Z","title":"ECAPA-TDNN: Emphasized Channel Attention, Propagation and Aggregation in TDNN Based Speaker Verification","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2005.07143","snapshot_observed_at":"2026-08-10T21:21:12.092625Z","title":"ECAPA-TDNN: Emphasized channel attention, propagation and aggregation in TDNN based speaker verification,","venue":null,"work_id":null,"year":2005},"citing_paper":{"arxiv_id":"2501.05127","last_updated":"2025-01-09T10:30:58Z","snapshot_observed_at":"2026-08-10T22:40:48.098162Z","submitted_at":"2025-01-09T10:30:58Z","title":"DiffAttack: Diffusion-based Timbre-reserved Adversarial Attack in Speaker Identification","version":1},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-10T21:21:12.092625Z"},"links":{"cited_paper":"/paper/2005.07143","citing_paper":"/paper/2501.05127"},"observation_digest":"sha256:c412dc2e5c7bbafcdd3112e94ce2628468bea2b7d15955663324625c7d682261","observation_id":"a3d5daff-2d59-47dc-a654-c5697143a4cd","resolution":{"observed_at":"2026-08-10T21:21:12.092625Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T21:21:12.494661Z","title":"Timbre-reserved adversarial attack in speaker identification,","venue":null,"work_id":"61a9c39f-5fda-4a7d-a6e9-563602450a4a","year":2023},"citing_paper":{"arxiv_id":"2501.05127","last_updated":"2025-01-09T10:30:58Z","snapshot_observed_at":"2026-08-10T22:40:48.098162Z","submitted_at":"2025-01-09T10:30:58Z","title":"DiffAttack: Diffusion-based Timbre-reserved Adversarial Attack in Speaker Identification","version":1},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-08-10T21:21:12.097763Z"},"links":{"citing_paper":"/paper/2501.05127"},"observation_digest":"sha256:5c1f8b122e5c1d82f0b1d93c9c17be00f4d1b878ef0068f82fa76d16b323bc65","observation_id":"fcbd3a5b-ac4d-4de6-af5a-e60a88b277e6","resolution":{"observed_at":"2026-08-10T21:21:12.500094Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T21:21:12.102618Z","title":"Fastspeech 2: Fast and high-quality end-to-end text to speech,","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2501.05127","last_updated":"2025-01-09T10:30:58Z","snapshot_observed_at":"2026-08-10T22:40:48.098162Z","submitted_at":"2025-01-09T10:30:58Z","title":"DiffAttack: Diffusion-based Timbre-reserved Adversarial Attack in Speaker Identification","version":1},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-08-10T21:21:12.102618Z"},"links":{"citing_paper":"/paper/2501.05127"},"observation_digest":"sha256:8cffddb34976f0f5f024312f20788e863314f0f0158b4c13177e303b0effaac9","observation_id":"00ea3ca5-3fd3-4cf3-ad84-147eb5a90d94","resolution":{"observed_at":"2026-08-10T21:21:12.102618Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2203.16937","last_updated":"2022-03-31T10:45:32Z","snapshot_observed_at":"2026-08-10T15:38:40.413551Z","submitted_at":"2022-03-31T10:45:32Z","title":"HiFi-VC: High Quality ASR-Based Voice Conversion","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2203.16937","snapshot_observed_at":"2026-08-10T21:21:12.107148Z","title":"HiFi-VC: High quality asr- based voice conversion,","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2501.05127","last_updated":"2025-01-09T10:30:58Z","snapshot_observed_at":"2026-08-10T22:40:48.098162Z","submitted_at":"2025-01-09T10:30:58Z","title":"DiffAttack: Diffusion-based Timbre-reserved Adversarial Attack in Speaker Identification","version":1},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-08-10T21:21:12.107148Z"},"links":{"cited_paper":"/paper/2203.16937","citing_paper":"/paper/2501.05127"},"observation_digest":"sha256:7476700918e597d6dd1d4ae299a990f219aa1031db4d69dc0c8f6010bcd67ff9","observation_id":"2cf3a1b2-6d23-46f9-8100-da554787a0b3","resolution":{"observed_at":"2026-08-10T21:21:12.107148Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2109.13821","last_updated":"2022-08-04T10:25:40Z","snapshot_observed_at":"2026-08-10T09:42:49.853165Z","submitted_at":"2021-09-28T15:48:22Z","title":"Diffusion-Based Voice Conversion with Fast Maximum Likelihood Sampling Scheme","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2109.13821","snapshot_observed_at":"2026-08-10T21:21:12.112357Z","title":"Diffusion-based voice conversion with fast maximum likelihood sam- pling scheme,","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2501.05127","last_updated":"2025-01-09T10:30:58Z","snapshot_observed_at":"2026-08-10T22:40:48.098162Z","submitted_at":"2025-01-09T10:30:58Z","title":"DiffAttack: Diffusion-based Timbre-reserved Adversarial Attack in Speaker Identification","version":1},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-08-10T21:21:12.112357Z"},"links":{"cited_paper":"/paper/2109.13821","citing_paper":"/paper/2501.05127"},"observation_digest":"sha256:1d0f8a512a299ab07ee3cb1ca1638245aaa8c27966496d1844150f7e0b4e17c2","observation_id":"57383cb9-df52-4d0a-abda-828db85abc72","resolution":{"observed_at":"2026-08-10T21:21:12.112357Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T21:21:12.117355Z","title":"Denoising diffusion probabilistic models,","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2501.05127","last_updated":"2025-01-09T10:30:58Z","snapshot_observed_at":"2026-08-10T22:40:48.098162Z","submitted_at":"2025-01-09T10:30:58Z","title":"DiffAttack: Diffusion-based Timbre-reserved Adversarial Attack in Speaker Identification","version":1},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-08-10T21:21:12.117355Z"},"links":{"citing_paper":"/paper/2501.05127"},"observation_digest":"sha256:d7b68d07d9d4f50bb8bafa756f39e3c69f836c0ecd3910005c0003a353923c40","observation_id":"06b5e38f-d8b1-47b6-b8a0-f0741f3b63ef","resolution":{"observed_at":"2026-08-10T21:21:12.117355Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1904.02882","last_updated":"2019-04-05T06:05:00Z","snapshot_observed_at":"2026-08-10T09:39:47.608323Z","submitted_at":"2019-04-05T06:05:00Z","title":"LibriTTS: A Corpus Derived from LibriSpeech for Text-to-Speech","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1904.02882","snapshot_observed_at":"2026-08-10T21:21:12.122141Z","title":"Libritts: A corpus derived from librispeech for text-to-speech,","venue":null,"work_id":null,"year":1904},"citing_paper":{"arxiv_id":"2501.05127","last_updated":"2025-01-09T10:30:58Z","snapshot_observed_at":"2026-08-10T22:40:48.098162Z","submitted_at":"2025-01-09T10:30:58Z","title":"DiffAttack: Diffusion-based Timbre-reserved Adversarial Attack in Speaker Identification","version":1},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-08-10T21:21:12.122141Z"},"links":{"cited_paper":"/paper/1904.02882","citing_paper":"/paper/2501.05127"},"observation_digest":"sha256:2adc2c812c0f0162aca5f8f97543ca0d57963c91453db0655e69a0067ce532ed","observation_id":"6d91d63b-5aa5-49bd-a1a1-1b0f50d3fcd9","resolution":{"observed_at":"2026-08-10T21:21:12.122141Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T21:21:12.457871Z","title":"HiFi-GAN: Generative adversarial net- works for efficient and high fidelity speech synthesis,","venue":null,"work_id":"85ebf3d1-405f-4288-af24-fc332d843a7b","year":2020},"citing_paper":{"arxiv_id":"2501.05127","last_updated":"2025-01-09T10:30:58Z","snapshot_observed_at":"2026-08-10T22:40:48.098162Z","submitted_at":"2025-01-09T10:30:58Z","title":"DiffAttack: Diffusion-based Timbre-reserved Adversarial Attack in Speaker Identification","version":1},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-08-10T21:21:12.127258Z"},"links":{"citing_paper":"/paper/2501.05127"},"observation_digest":"sha256:7936f11368969b86520b62cfe9efa41b7b80eb6d4f07782f5c25699fccf72c36","observation_id":"b738002e-d37d-4ed8-8504-74b3fd97f41f","resolution":{"observed_at":"2026-08-10T21:21:12.463257Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T21:21:12.131650Z","title":"Grad- tts: A diffusion probabilistic model for text-to-speech,","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2501.05127","last_updated":"2025-01-09T10:30:58Z","snapshot_observed_at":"2026-08-10T22:40:48.098162Z","submitted_at":"2025-01-09T10:30:58Z","title":"DiffAttack: Diffusion-based Timbre-reserved Adversarial Attack in Speaker Identification","version":1},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-08-10T21:21:12.131650Z"},"links":{"citing_paper":"/paper/2501.05127"},"observation_digest":"sha256:f58a52476467c9b5bcfdb3c42a5a9f4894edc59829d56c24953803a481aa9b42","observation_id":"9ec9a07a-6d29-4f31-b8a8-f2be3e870b0c","resolution":{"observed_at":"2026-08-10T21:21:12.131650Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T21:21:12.136222Z","title":"Montreal forced aligner: Trainable text-speech alignment using kaldi","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2501.05127","last_updated":"2025-01-09T10:30:58Z","snapshot_observed_at":"2026-08-10T22:40:48.098162Z","submitted_at":"2025-01-09T10:30:58Z","title":"DiffAttack: Diffusion-based Timbre-reserved Adversarial Attack in Speaker Identification","version":1},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-08-10T21:21:12.136222Z"},"links":{"citing_paper":"/paper/2501.05127"},"observation_digest":"sha256:af959fcc8eb9d781a17ef14011b8a8a363108a022b0f6d04e4fbd87fd4cc1c39","observation_id":"b1eb9826-4811-4529-aa7d-5cddcd492491","resolution":{"observed_at":"2026-08-10T21:21:12.136222Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T21:21:12.141028Z","title":"U-net: Convolutional networks for biomedical image segmentation,","venue":null,"work_id":null,"year":2015},"citing_paper":{"arxiv_id":"2501.05127","last_updated":"2025-01-09T10:30:58Z","snapshot_observed_at":"2026-08-10T22:40:48.098162Z","submitted_at":"2025-01-09T10:30:58Z","title":"DiffAttack: Diffusion-based Timbre-reserved Adversarial Attack in Speaker Identification","version":1},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-08-10T21:21:12.141028Z"},"links":{"citing_paper":"/paper/2501.05127"},"observation_digest":"sha256:665dcbdf2d0b71e88c4d81dfd1974b7d2b14744216334f01332984cd19b1df40","observation_id":"9506357c-8d5b-4849-b921-cbbfa58ecdf5","resolution":{"observed_at":"2026-08-10T21:21:12.141028Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T21:21:12.145944Z","title":null,"venue":null,"work_id":null,"year":2015},"citing_paper":{"arxiv_id":"2501.05127","last_updated":"2025-01-09T10:30:58Z","snapshot_observed_at":"2026-08-10T22:40:48.098162Z","submitted_at":"2025-01-09T10:30:58Z","title":"DiffAttack: Diffusion-based Timbre-reserved Adversarial Attack in Speaker Identification","version":1},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-08-10T21:21:12.145944Z"},"links":{"citing_paper":"/paper/2501.05127"},"observation_digest":"sha256:6e99c9ab18b41395487782c87b7b286b932e45ea141e00996ed3ae4cd672c5eb","observation_id":"0faba8e5-e2fb-4340-ac6b-383e8566509e","resolution":{"observed_at":"2026-08-10T21:21:12.145944Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T21:21:12.150795Z","title":null,"venue":null,"work_id":null,"year":1992},"citing_paper":{"arxiv_id":"2501.05127","last_updated":"2025-01-09T10:30:58Z","snapshot_observed_at":"2026-08-10T22:40:48.098162Z","submitted_at":"2025-01-09T10:30:58Z","title":"DiffAttack: Diffusion-based Timbre-reserved Adversarial Attack in Speaker Identification","version":1},"reference_index":36,"source":"pdf_text","source_observed_at":"2026-08-10T21:21:12.150795Z"},"links":{"citing_paper":"/paper/2501.05127"},"observation_digest":"sha256:1861b765e10278be42df7880ab2683deecb495387345783c34b818576dc48387","observation_id":"c7bbf49e-ddcf-453a-bee8-a4e40873825e","resolution":{"observed_at":"2026-08-10T21:21:12.150795Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1706.08612","last_updated":"2018-05-30T06:52:06Z","snapshot_observed_at":"2026-08-08T04:51:01.052037Z","submitted_at":"2017-06-26T21:42:27Z","title":"VoxCeleb: a large-scale speaker identification dataset","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1706.08612","snapshot_observed_at":"2026-08-10T21:21:12.155355Z","title":"V oxceleb: a large-scale speaker identification dataset,","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2501.05127","last_updated":"2025-01-09T10:30:58Z","snapshot_observed_at":"2026-08-10T22:40:48.098162Z","submitted_at":"2025-01-09T10:30:58Z","title":"DiffAttack: Diffusion-based Timbre-reserved Adversarial Attack in Speaker Identification","version":1},"reference_index":37,"source":"pdf_text","source_observed_at":"2026-08-10T21:21:12.155355Z"},"links":{"cited_paper":"/paper/1706.08612","citing_paper":"/paper/2501.05127"},"observation_digest":"sha256:b89c24b2af836efc4d480caaa6515c8d6a379455a04c8ff58cca5db407a06821","observation_id":"eb1984e4-1abf-4b67-9ad4-b9c6ac3bfa8b","resolution":{"observed_at":"2026-08-10T21:21:12.155355Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1806.05622","last_updated":"2018-06-27T01:49:17Z","snapshot_observed_at":"2026-08-08T04:36:13.309903Z","submitted_at":"2018-06-14T15:59:12Z","title":"VoxCeleb2: Deep Speaker Recognition","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1806.05622","snapshot_observed_at":"2026-08-10T21:21:12.160173Z","title":"V oxceleb2: Deep speaker recognition,","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2501.05127","last_updated":"2025-01-09T10:30:58Z","snapshot_observed_at":"2026-08-10T22:40:48.098162Z","submitted_at":"2025-01-09T10:30:58Z","title":"DiffAttack: Diffusion-based Timbre-reserved Adversarial Attack in Speaker Identification","version":1},"reference_index":38,"source":"pdf_text","source_observed_at":"2026-08-10T21:21:12.160173Z"},"links":{"cited_paper":"/paper/1806.05622","citing_paper":"/paper/2501.05127"},"observation_digest":"sha256:679ddd180c54459c76fbcafb21594990969c0eab6e8cb24d5cf475a605f5c51b","observation_id":"92e82a91-5be4-4c8f-85a2-6859567d993b","resolution":{"observed_at":"2026-08-10T21:21:12.160173Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T21:21:12.390679Z","title":"Distance-based weight transfer for fine-tuning from near-field to far- field speaker verification,","venue":null,"work_id":"4dbf7c52-86d3-4cb2-875c-91419c2bcc81","year":2023},"citing_paper":{"arxiv_id":"2501.05127","last_updated":"2025-01-09T10:30:58Z","snapshot_observed_at":"2026-08-10T22:40:48.098162Z","submitted_at":"2025-01-09T10:30:58Z","title":"DiffAttack: Diffusion-based Timbre-reserved Adversarial Attack in Speaker Identification","version":1},"reference_index":39,"source":"pdf_text","source_observed_at":"2026-08-10T21:21:12.165112Z"},"links":{"citing_paper":"/paper/2501.05127"},"observation_digest":"sha256:02db2d2168e5333d6b7950807d6d4d1115f23da3149897823a365a679031396c","observation_id":"ac9cabf0-6aa1-4d6e-b460-faa1e4f02a23","resolution":{"observed_at":"2026-08-10T21:21:12.395819Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1904.08352","last_updated":"2021-07-14T07:32:49Z","snapshot_observed_at":"2026-08-10T22:39:41.293007Z","submitted_at":"2019-04-17T16:38:31Z","title":"MOSNet: Deep Learning based Objective Assessment for Voice Conversion","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1904.08352","snapshot_observed_at":"2026-08-10T21:21:12.169911Z","title":"Mosnet: Deep learning based objective assessment for voice conversion,","venue":null,"work_id":null,"year":1904},"citing_paper":{"arxiv_id":"2501.05127","last_updated":"2025-01-09T10:30:58Z","snapshot_observed_at":"2026-08-10T22:40:48.098162Z","submitted_at":"2025-01-09T10:30:58Z","title":"DiffAttack: Diffusion-based Timbre-reserved Adversarial Attack in Speaker Identification","version":1},"reference_index":40,"source":"pdf_text","source_observed_at":"2026-08-10T21:21:12.169911Z"},"links":{"cited_paper":"/paper/1904.08352","citing_paper":"/paper/2501.05127"},"observation_digest":"sha256:7894280e7794bd32e7201f496090fbb3280cc097b2e6b21c7ce20ad9f701e170","observation_id":"4ee01c43-168f-4f9c-b1ca-a1a4bb7c612e","resolution":{"observed_at":"2026-08-10T21:21:12.169911Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"paper":{"arxiv_id":"2501.05127","last_updated":"2025-01-09T10:30:58Z","latest_version":1,"primary_category":"cs.SD","snapshot_observed_at":"2026-08-10T22:40:48.098162Z","submitted_at":"2025-01-09T10:30:58Z","title":"DiffAttack: Diffusion-based Timbre-reserved Adversarial Attack in Speaker Identification"},"reference_resolution":{"displayed":40,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":18,"verified_exact":1,"verified_fuzzy":21},"total_outbound_references":40},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"thesis":"As of 12 August 2026, this Paper Citation Record lists 40 of 40 outbound references and 0 inbound Pith citation observations for arXiv:2501.05127."}