{"as_of":"2026-08-22T01:20:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:2da132718df610d90f6ded616a572640948e19a6a738e838f2c47b1088894989","coverage":[{"denominator":41,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":41,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-10T20:25:17.304984Z","state":"measured"},{"denominator":41,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":41,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-21T06:32:19.484+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2501.08691/citation-record","integrity":"/paper/2501.08691/integrity","json":"/paper/2501.08691/citation-record.json","paper":"/paper/2501.08691"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T20:25:17.921990Z","title":"An overview of automatic speaker verification system","venue":null,"work_id":"5451eaf8-ef4c-47bd-a1d0-e9178327521b","year":2017},"citing_paper":{"arxiv_id":"2501.08691","last_updated":"2025-01-15T09:50:19Z","snapshot_observed_at":"2026-08-13T23:18:53.864836Z","submitted_at":"2025-01-15T09:50:19Z","title":"Adaptive Data Augmentation with NaturalSpeech3 for Far-field Speaker Verification","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-10T20:25:17.128638Z"},"links":{"citing_paper":"/paper/2501.08691"},"observation_digest":"sha256:aeb3d45fd8c54038c2990b8f0e55cd83aef5076c2eecbf0f04f9bdcb4773ec4b","observation_id":"f7aa6112-747a-4826-ad78-023bbe2bb730","resolution":{"observed_at":"2026-08-10T20:25:17.926666Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T20:25:17.133978Z","title":"V oxceleb: Large-scale speaker verification in the wild.Computer Speech & Language, 60:101027, 2020","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2501.08691","last_updated":"2025-01-15T09:50:19Z","snapshot_observed_at":"2026-08-13T23:18:53.864836Z","submitted_at":"2025-01-15T09:50:19Z","title":"Adaptive Data Augmentation with NaturalSpeech3 for Far-field Speaker Verification","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-10T20:25:17.133978Z"},"links":{"citing_paper":"/paper/2501.08691"},"observation_digest":"sha256:fb0328559d1fb2af0ffbc859640aa17b70712fade90dc9845cd831250ba90163","observation_id":"3ce7e09f-8dae-4780-8ac8-90a4fab1c0aa","resolution":{"observed_at":"2026-08-10T20:25:17.133978Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T20:25:17.898685Z","title":"Aishell-1: An open-source mandarin speech corpus and a speech recognition baseline","venue":null,"work_id":"c057e67e-9fd2-4515-aa1f-f3fb2e3abb53","year":2017},"citing_paper":{"arxiv_id":"2501.08691","last_updated":"2025-01-15T09:50:19Z","snapshot_observed_at":"2026-08-13T23:18:53.864836Z","submitted_at":"2025-01-15T09:50:19Z","title":"Adaptive Data Augmentation with NaturalSpeech3 for Far-field Speaker Verification","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-10T20:25:17.138678Z"},"links":{"citing_paper":"/paper/2501.08691"},"observation_digest":"sha256:152e6bdb0cce0fa2733328b90bbbdf09173f679c593c11b9507f043fe5d73d92","observation_id":"91858d7a-acc8-464f-828c-7c8b603669a6","resolution":{"observed_at":"2026-08-10T20:25:17.903535Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1808.10583","last_updated":"2018-09-13T02:45:27Z","snapshot_observed_at":"2026-08-14T18:34:46.662561Z","submitted_at":"2018-08-31T03:11:08Z","title":"AISHELL-2: Transforming Mandarin ASR Research Into Industrial Scale","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1808.10583","snapshot_observed_at":"2026-08-10T20:25:17.143279Z","title":"Aishell-2: Trans- forming mandarin asr research into industrial scale","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2501.08691","last_updated":"2025-01-15T09:50:19Z","snapshot_observed_at":"2026-08-13T23:18:53.864836Z","submitted_at":"2025-01-15T09:50:19Z","title":"Adaptive Data Augmentation with NaturalSpeech3 for Far-field Speaker Verification","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-10T20:25:17.143279Z"},"links":{"cited_paper":"/paper/1808.10583","citing_paper":"/paper/2501.08691"},"observation_digest":"sha256:9b8095ffb0443bd8066bfdbccfc8a5998f90a3be5bf06ba3c8d138f4e15fdea4","observation_id":"2b939188-a463-43aa-abd9-ba8514b217c2","resolution":{"observed_at":"2026-08-10T20:25:17.143279Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T20:25:17.884660Z","title":"Intel far-field speaker recognition system for voices challenge 2019","venue":null,"work_id":"eb1c8e3c-6a69-44c0-b68b-035ae1797236","year":2019},"citing_paper":{"arxiv_id":"2501.08691","last_updated":"2025-01-15T09:50:19Z","snapshot_observed_at":"2026-08-13T23:18:53.864836Z","submitted_at":"2025-01-15T09:50:19Z","title":"Adaptive Data Augmentation with NaturalSpeech3 for Far-field Speaker Verification","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-10T20:25:17.148860Z"},"links":{"citing_paper":"/paper/2501.08691"},"observation_digest":"sha256:44eb07817487f24605beb0882febfe1982c235d29d0e7f57ed3ac7e80a23c9a3","observation_id":"d251519e-2cbe-4be3-b7d8-8f6db6a8560a","resolution":{"observed_at":"2026-08-10T20:25:17.889503Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T20:25:17.869780Z","title":"Far-field speaker verification challenge (ffsvc) 2022: Challenge evaluation plan, 2022","venue":null,"work_id":"43055e27-510f-4709-9cff-28f1fe92717f","year":2022},"citing_paper":{"arxiv_id":"2501.08691","last_updated":"2025-01-15T09:50:19Z","snapshot_observed_at":"2026-08-13T23:18:53.864836Z","submitted_at":"2025-01-15T09:50:19Z","title":"Adaptive Data Augmentation with NaturalSpeech3 for Far-field Speaker Verification","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-10T20:25:17.153207Z"},"links":{"citing_paper":"/paper/2501.08691"},"observation_digest":"sha256:936c7bba9c2cfb7987db575bda81f47250062ed6155c14fbb3e30d5b89515366","observation_id":"ef53dd24-62a0-4c33-b27c-9ab4fe5e07fb","resolution":{"observed_at":"2026-08-10T20:25:17.875067Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T20:25:17.855849Z","title":"The voices from a distance challenge 2019","venue":null,"work_id":"bf093cf2-4abd-4c47-b1a4-c88876db6209","year":2019},"citing_paper":{"arxiv_id":"2501.08691","last_updated":"2025-01-15T09:50:19Z","snapshot_observed_at":"2026-08-13T23:18:53.864836Z","submitted_at":"2025-01-15T09:50:19Z","title":"Adaptive Data Augmentation with NaturalSpeech3 for Far-field Speaker Verification","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-10T20:25:17.158310Z"},"links":{"citing_paper":"/paper/2501.08691"},"observation_digest":"sha256:d40effcc9bb604d5732f67a08773b1c2661f2e160808064d80afbeab46ca94cd","observation_id":"65a75c83-b0b7-4121-9071-c46918c9669f","resolution":{"observed_at":"2026-08-10T20:25:17.860376Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T20:25:17.842066Z","title":"Hi-mia: A far-field text-dependent speaker verification database and the baselines","venue":null,"work_id":"2633b942-ace8-4950-a97c-0fb4abb14844","year":2020},"citing_paper":{"arxiv_id":"2501.08691","last_updated":"2025-01-15T09:50:19Z","snapshot_observed_at":"2026-08-13T23:18:53.864836Z","submitted_at":"2025-01-15T09:50:19Z","title":"Adaptive Data Augmentation with NaturalSpeech3 for Far-field Speaker Verification","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-10T20:25:17.162598Z"},"links":{"citing_paper":"/paper/2501.08691"},"observation_digest":"sha256:dd5f47f9ef5607ea101299985f47f4b5bac1f597617cf41cff10504c7753a5a0","observation_id":"55a16a56-8a2c-4dfd-8eee-2d6e1f004bc4","resolution":{"observed_at":"2026-08-10T20:25:17.846639Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T20:25:17.827530Z","title":"Multisv: Dataset for far-field multi-channel speaker verifi- cation","venue":null,"work_id":"793a2b39-f8f9-4091-a01d-8432cd1c03f0","year":2022},"citing_paper":{"arxiv_id":"2501.08691","last_updated":"2025-01-15T09:50:19Z","snapshot_observed_at":"2026-08-13T23:18:53.864836Z","submitted_at":"2025-01-15T09:50:19Z","title":"Adaptive Data Augmentation with NaturalSpeech3 for Far-field Speaker Verification","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-10T20:25:17.167063Z"},"links":{"citing_paper":"/paper/2501.08691"},"observation_digest":"sha256:a0ce669d7f3764829c26832417175e96f2bdc28ed15a9014f7ec46f0918a2bb4","observation_id":"942e3772-ed0d-49f2-b42c-e529069f8e17","resolution":{"observed_at":"2026-08-10T20:25:17.832387Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2008.03521","last_updated":"2020-08-08T13:32:48Z","snapshot_observed_at":"2026-08-20T06:28:54.945370Z","submitted_at":"2020-08-08T13:32:48Z","title":"NPU Speaker Verification System for INTERSPEECH 2020 Far-Field Speaker Verification Challenge","version":1},"cited_work":{"arxiv_id":"2008.03521","doi":null,"metadata_source":"pith","pith_arxiv_id":"2008.03521","snapshot_observed_at":"2026-08-10T20:25:17.454811Z","title":"NPU Speaker Verification System for INTERSPEECH 2020 Far-Field Speaker Verification Challenge","venue":"eess.AS","work_id":"ad603725-e0e7-4491-b14d-cb3f71d372ad","year":2020},"citing_paper":{"arxiv_id":"2501.08691","last_updated":"2025-01-15T09:50:19Z","snapshot_observed_at":"2026-08-13T23:18:53.864836Z","submitted_at":"2025-01-15T09:50:19Z","title":"Adaptive Data Augmentation with NaturalSpeech3 for Far-field Speaker Verification","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-10T20:25:17.171400Z"},"links":{"cited_paper":"/paper/2008.03521","citing_paper":"/paper/2501.08691"},"observation_digest":"sha256:5aeec0e1f643b50e9f0cb1e0d4f8f7825f4e521b07dfbd67bd9df3ccacacb38c","observation_id":"ca6f9c05-3012-4e26-830e-0ab0d0186296","resolution":{"observed_at":"2026-08-10T20:25:17.459787Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2005.08046","last_updated":"2020-05-16T17:13:28Z","snapshot_observed_at":"2026-08-20T05:09:00.899580Z","submitted_at":"2020-05-16T17:13:28Z","title":"The INTERSPEECH 2020 Far-Field Speaker Verification Challenge","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2005.08046","snapshot_observed_at":"2026-08-10T20:25:17.175876Z","title":"The interspeech 2020 far-field speaker verification challenge","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2501.08691","last_updated":"2025-01-15T09:50:19Z","snapshot_observed_at":"2026-08-13T23:18:53.864836Z","submitted_at":"2025-01-15T09:50:19Z","title":"Adaptive Data Augmentation with NaturalSpeech3 for Far-field Speaker Verification","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-10T20:25:17.175876Z"},"links":{"cited_paper":"/paper/2005.08046","citing_paper":"/paper/2501.08691"},"observation_digest":"sha256:23cc2c75596aec927b5d3be638725bfc3e9cc325440e501797edb9ad128d296b","observation_id":"ee864b9c-1c25-495d-b7b8-74a299dfdb94","resolution":{"observed_at":"2026-08-10T20:25:17.175876Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T20:25:17.812102Z","title":"Multi-channel speaker verification with conv-tasnet based beamformer","venue":null,"work_id":"1848500b-3ae7-4215-aa68-f75db4927431","year":2022},"citing_paper":{"arxiv_id":"2501.08691","last_updated":"2025-01-15T09:50:19Z","snapshot_observed_at":"2026-08-13T23:18:53.864836Z","submitted_at":"2025-01-15T09:50:19Z","title":"Adaptive Data Augmentation with NaturalSpeech3 for Far-field Speaker Verification","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-10T20:25:17.180413Z"},"links":{"citing_paper":"/paper/2501.08691"},"observation_digest":"sha256:2a601561e2cfabbde9e5893a98652662f99ab924bd4151ebedfa19fdc00ff659","observation_id":"7875d4f7-8170-43ba-bb19-0ab0d0da6922","resolution":{"observed_at":"2026-08-10T20:25:17.817732Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2110.05975","last_updated":"2022-03-28T11:51:16Z","snapshot_observed_at":"2026-08-16T17:49:59.416236Z","submitted_at":"2021-10-12T13:04:32Z","title":"Multi-Channel Far-Field Speaker Verification with Large-Scale Ad-hoc Microphone Arrays","version":3},"cited_work":{"arxiv_id":"2110.05975","doi":null,"metadata_source":"pith","pith_arxiv_id":"2110.05975","snapshot_observed_at":"2026-08-10T20:25:17.419104Z","title":"Multi-Channel Far-Field Speaker Verification with Large-Scale Ad-hoc Microphone Arrays","venue":"cs.SD","work_id":"e124080e-fe9a-415a-827a-43bd1e96a97c","year":2021},"citing_paper":{"arxiv_id":"2501.08691","last_updated":"2025-01-15T09:50:19Z","snapshot_observed_at":"2026-08-13T23:18:53.864836Z","submitted_at":"2025-01-15T09:50:19Z","title":"Adaptive Data Augmentation with NaturalSpeech3 for Far-field Speaker Verification","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-10T20:25:17.184691Z"},"links":{"cited_paper":"/paper/2110.05975","citing_paper":"/paper/2501.08691"},"observation_digest":"sha256:af51256b7b2e9909aca3ce65c1a4e9bd77780a9c4b6f8c8935fd26616e3dcfcf","observation_id":"365b8ea8-4f34-4d7f-bebc-c4cae7fa7bb1","resolution":{"observed_at":"2026-08-10T20:25:17.424043Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T20:25:17.798451Z","title":"Unet-densenet for robust far-field speaker verification","venue":null,"work_id":"8e34ea72-31f9-44a0-b3f4-014c1a99468b","year":2022},"citing_paper":{"arxiv_id":"2501.08691","last_updated":"2025-01-15T09:50:19Z","snapshot_observed_at":"2026-08-13T23:18:53.864836Z","submitted_at":"2025-01-15T09:50:19Z","title":"Adaptive Data Augmentation with NaturalSpeech3 for Far-field Speaker Verification","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-10T20:25:17.189068Z"},"links":{"citing_paper":"/paper/2501.08691"},"observation_digest":"sha256:05748dc2c4b18dd9727451eab1b970a88ce6bd1e8caba100e764a3ea5ab45570","observation_id":"d8895ca0-d14f-4aee-9ca1-a7a822bfbc50","resolution":{"observed_at":"2026-08-10T20:25:17.802967Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T20:25:17.784273Z","title":"Dereverberation and beamforming in robust far-field speaker recognition","venue":null,"work_id":"a5e93110-aff6-4607-b24b-f88b9afaa916","year":2018},"citing_paper":{"arxiv_id":"2501.08691","last_updated":"2025-01-15T09:50:19Z","snapshot_observed_at":"2026-08-13T23:18:53.864836Z","submitted_at":"2025-01-15T09:50:19Z","title":"Adaptive Data Augmentation with NaturalSpeech3 for Far-field Speaker Verification","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-10T20:25:17.193467Z"},"links":{"citing_paper":"/paper/2501.08691"},"observation_digest":"sha256:28becefe6d57d4e3fd690f98a86300803b5ed6ee4bfea6e69cf604459a61df15","observation_id":"536886ba-af4b-4459-9e1a-45b3c51ae5a6","resolution":{"observed_at":"2026-08-10T20:25:17.789298Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T20:25:17.771064Z","title":"Far-field end-to-end text- dependent speaker verification based on mixed training data with transfer learning and enrollment data augmentation","venue":null,"work_id":"91759eef-922c-4ade-9d29-821cffd409fd","year":2019},"citing_paper":{"arxiv_id":"2501.08691","last_updated":"2025-01-15T09:50:19Z","snapshot_observed_at":"2026-08-13T23:18:53.864836Z","submitted_at":"2025-01-15T09:50:19Z","title":"Adaptive Data Augmentation with NaturalSpeech3 for Far-field Speaker Verification","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-10T20:25:17.197702Z"},"links":{"citing_paper":"/paper/2501.08691"},"observation_digest":"sha256:5c6b24379c6e19ee909083c5c730542b4bb769074ce582f384533b377de1f053","observation_id":"dfe807bb-0132-490a-953e-780409249d4c","resolution":{"observed_at":"2026-08-10T20:25:17.775708Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T20:25:17.757507Z","title":"Stc-innovation speaker recognition systems for far- field speaker verification challenge 2020","venue":null,"work_id":"a29b0b83-56df-485b-bb50-c415df9a0de5","year":2020},"citing_paper":{"arxiv_id":"2501.08691","last_updated":"2025-01-15T09:50:19Z","snapshot_observed_at":"2026-08-13T23:18:53.864836Z","submitted_at":"2025-01-15T09:50:19Z","title":"Adaptive Data Augmentation with NaturalSpeech3 for Far-field Speaker Verification","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-10T20:25:17.201863Z"},"links":{"citing_paper":"/paper/2501.08691"},"observation_digest":"sha256:d623e81da1cfaea5e6c3e5b84176d4cdd4a5e49725d665905940fce37c18dfad","observation_id":"3948982b-7f12-4cfe-b516-6aabb0bf381f","resolution":{"observed_at":"2026-08-10T20:25:17.762207Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T20:25:17.744171Z","title":"Npu-hc speaker verification system for far-field speaker verification challenge 2022","venue":null,"work_id":"df1aee31-9a43-461d-a915-4b5a8767cee5","year":2022},"citing_paper":{"arxiv_id":"2501.08691","last_updated":"2025-01-15T09:50:19Z","snapshot_observed_at":"2026-08-13T23:18:53.864836Z","submitted_at":"2025-01-15T09:50:19Z","title":"Adaptive Data Augmentation with NaturalSpeech3 for Far-field Speaker Verification","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-10T20:25:17.205898Z"},"links":{"citing_paper":"/paper/2501.08691"},"observation_digest":"sha256:294a2c68bea45de3012f24830ebebc57aac55f27b95ce239d59f065c798c4abf","observation_id":"429b0b3c-1e80-4c3e-bf81-a3ca6712b633","resolution":{"observed_at":"2026-08-10T20:25:17.748476Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1904.08779","last_updated":"2019-12-03T18:19:07Z","snapshot_observed_at":"2026-08-15T18:44:59.455586Z","submitted_at":"2019-04-18T17:53:38Z","title":"SpecAugment: A Simple Data Augmentation Method for Automatic Speech Recognition","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1904.08779","snapshot_observed_at":"2026-08-10T20:25:17.209834Z","title":"Specaugment: A simple data augmentation method for automatic speech recognition","venue":null,"work_id":null,"year":1904},"citing_paper":{"arxiv_id":"2501.08691","last_updated":"2025-01-15T09:50:19Z","snapshot_observed_at":"2026-08-13T23:18:53.864836Z","submitted_at":"2025-01-15T09:50:19Z","title":"Adaptive Data Augmentation with NaturalSpeech3 for Far-field Speaker Verification","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-10T20:25:17.209834Z"},"links":{"cited_paper":"/paper/1904.08779","citing_paper":"/paper/2501.08691"},"observation_digest":"sha256:b17bef5cd9413a07882d3620ccb6d6d2cd44478d9210e04b8a0331ce2803a176","observation_id":"4012f9d8-3fcf-4840-a6e4-8a5fdca92675","resolution":{"observed_at":"2026-08-10T20:25:17.209834Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T20:25:17.730200Z","title":"Robust speaker verification using population-based data augmentation","venue":null,"work_id":"0a8ac3c7-2d09-42ff-b71b-d54bfd979fa3","year":2022},"citing_paper":{"arxiv_id":"2501.08691","last_updated":"2025-01-15T09:50:19Z","snapshot_observed_at":"2026-08-13T23:18:53.864836Z","submitted_at":"2025-01-15T09:50:19Z","title":"Adaptive Data Augmentation with NaturalSpeech3 for Far-field Speaker Verification","version":1},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-10T20:25:17.214748Z"},"links":{"citing_paper":"/paper/2501.08691"},"observation_digest":"sha256:a75bf49eb4241f7d2f9a216871d63699c889cae3d88091a6f15655aa522bf8e9","observation_id":"ebecec8f-489f-4c80-8989-941eaa9df882","resolution":{"observed_at":"2026-08-10T20:25:17.734943Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T20:25:17.715793Z","title":"Distance-based weight transfer for fine-tuning from near- field to far-field speaker verification","venue":null,"work_id":"1891d5c4-0c4a-4093-a9af-a3f41f503e1d","year":2023},"citing_paper":{"arxiv_id":"2501.08691","last_updated":"2025-01-15T09:50:19Z","snapshot_observed_at":"2026-08-13T23:18:53.864836Z","submitted_at":"2025-01-15T09:50:19Z","title":"Adaptive Data Augmentation with NaturalSpeech3 for Far-field Speaker Verification","version":1},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-10T20:25:17.219482Z"},"links":{"citing_paper":"/paper/2501.08691"},"observation_digest":"sha256:5f66c61041e002dca853e7e91cefd0ea34680d9c63fa313f6af465783ccbb73d","observation_id":"a6b0417d-0f4b-49b5-ab6f-6ea67e102e87","resolution":{"observed_at":"2026-08-10T20:25:17.720508Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2403.03100","last_updated":"2024-04-23T08:38:03Z","snapshot_observed_at":"2026-08-18T17:50:58.009731Z","submitted_at":"2024-03-05T16:35:25Z","title":"NaturalSpeech 3: Zero-Shot Speech Synthesis with Factorized Codec and Diffusion Models","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2403.03100","snapshot_observed_at":"2026-08-10T20:25:17.223749Z","title":"Naturalspeech 3: Zero-shot speech synthesis with factorized codec and diffusion models","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2501.08691","last_updated":"2025-01-15T09:50:19Z","snapshot_observed_at":"2026-08-13T23:18:53.864836Z","submitted_at":"2025-01-15T09:50:19Z","title":"Adaptive Data Augmentation with NaturalSpeech3 for Far-field Speaker Verification","version":1},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-10T20:25:17.223749Z"},"links":{"cited_paper":"/paper/2403.03100","citing_paper":"/paper/2501.08691"},"observation_digest":"sha256:8549a3de0ba2128a66bcb0d42b967e772eab0cd78a94a5c4fe9567128f944ff8","observation_id":"1cc1c535-60c4-4c1c-94ca-d673d0e49ad7","resolution":{"observed_at":"2026-08-10T20:25:17.223749Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T20:25:17.700716Z","title":"X-vectors: Robust dnn embeddings for speaker recognition","venue":null,"work_id":"28bc7698-0235-40ba-8958-9877aad9a774","year":2018},"citing_paper":{"arxiv_id":"2501.08691","last_updated":"2025-01-15T09:50:19Z","snapshot_observed_at":"2026-08-13T23:18:53.864836Z","submitted_at":"2025-01-15T09:50:19Z","title":"Adaptive Data Augmentation with NaturalSpeech3 for Far-field Speaker Verification","version":1},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-10T20:25:17.228108Z"},"links":{"citing_paper":"/paper/2501.08691"},"observation_digest":"sha256:95c49c6383bd1eef466aeba178f5e3ad23f40455a8eca60346abc83276adcde9","observation_id":"3b371a24-8027-4ced-a5b4-97cca5032c52","resolution":{"observed_at":"2026-08-10T20:25:17.705569Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T20:25:17.685449Z","title":"Specaugment impact on automatic speaker verification system","venue":null,"work_id":"c04cde24-63ca-4602-a83c-15669bd0c827","year":2019},"citing_paper":{"arxiv_id":"2501.08691","last_updated":"2025-01-15T09:50:19Z","snapshot_observed_at":"2026-08-13T23:18:53.864836Z","submitted_at":"2025-01-15T09:50:19Z","title":"Adaptive Data Augmentation with NaturalSpeech3 for Far-field Speaker Verification","version":1},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-10T20:25:17.232209Z"},"links":{"citing_paper":"/paper/2501.08691"},"observation_digest":"sha256:5568e981eedf31f17dfa60b78d93c16a36615ec611c39c02128752bd580ba216","observation_id":"5e004615-d655-4e46-a825-bff543b31d02","resolution":{"observed_at":"2026-08-10T20:25:17.690202Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2201.05562","last_updated":"2022-01-14T17:09:22Z","snapshot_observed_at":"2026-08-16T17:28:18.210557Z","submitted_at":"2022-01-14T17:09:22Z","title":"Investigation of Data Augmentation Techniques for Disordered Speech Recognition","version":1},"cited_work":{"arxiv_id":"2201.05562","doi":null,"metadata_source":"pith","pith_arxiv_id":"2201.05562","snapshot_observed_at":"2026-08-10T20:25:17.367752Z","title":"Investigation of Data Augmentation Techniques for Disordered Speech Recognition","venue":"cs.SD","work_id":"e6d065f8-7738-4417-86bf-c3dee148054e","year":2022},"citing_paper":{"arxiv_id":"2501.08691","last_updated":"2025-01-15T09:50:19Z","snapshot_observed_at":"2026-08-13T23:18:53.864836Z","submitted_at":"2025-01-15T09:50:19Z","title":"Adaptive Data Augmentation with NaturalSpeech3 for Far-field Speaker Verification","version":1},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-08-10T20:25:17.236441Z"},"links":{"cited_paper":"/paper/2201.05562","citing_paper":"/paper/2501.08691"},"observation_digest":"sha256:39f6d4db5d573fec998fb0d9d70edbb67c6af716e3320af9cae9841c5c4dd220","observation_id":"28696dba-c2a2-4158-a691-16dc77ce8c67","resolution":{"observed_at":"2026-08-10T20:25:17.375443Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T20:25:17.671210Z","title":"Improved far-field speaker recognition method based geometry acoustic simulation and specaugment","venue":null,"work_id":"b378fdda-0fa9-4c56-b44f-302b1898e528","year":2021},"citing_paper":{"arxiv_id":"2501.08691","last_updated":"2025-01-15T09:50:19Z","snapshot_observed_at":"2026-08-13T23:18:53.864836Z","submitted_at":"2025-01-15T09:50:19Z","title":"Adaptive Data Augmentation with NaturalSpeech3 for Far-field Speaker Verification","version":1},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-08-10T20:25:17.240752Z"},"links":{"citing_paper":"/paper/2501.08691"},"observation_digest":"sha256:eaec56f76ab5e9f346692e0be23de9bd20dda9ee8a841f074dcbd259c3f4ad99","observation_id":"bb4c3950-397f-44c3-b2be-12465c1d428d","resolution":{"observed_at":"2026-08-10T20:25:17.676106Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T20:25:17.655714Z","title":"A study on data augmentation of reverberant speech for robust speech recognition","venue":null,"work_id":"0c98a391-5d98-4050-ba40-1a295fbea5fc","year":2017},"citing_paper":{"arxiv_id":"2501.08691","last_updated":"2025-01-15T09:50:19Z","snapshot_observed_at":"2026-08-13T23:18:53.864836Z","submitted_at":"2025-01-15T09:50:19Z","title":"Adaptive Data Augmentation with NaturalSpeech3 for Far-field Speaker Verification","version":1},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-08-10T20:25:17.244825Z"},"links":{"citing_paper":"/paper/2501.08691"},"observation_digest":"sha256:4045a1212679577e9b95a94355a55e89a28983c1b1ac3b0c5993873c2254e750","observation_id":"196ac8ea-e2fe-437b-ace5-ee3fde021ba4","resolution":{"observed_at":"2026-08-10T20:25:17.660945Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T20:25:17.640296Z","title":"Synaug: Synthesis-based data augmentation for text-dependent speaker verification","venue":null,"work_id":"0f890d7f-03f0-407c-8025-25317c9dc7b9","year":2021},"citing_paper":{"arxiv_id":"2501.08691","last_updated":"2025-01-15T09:50:19Z","snapshot_observed_at":"2026-08-13T23:18:53.864836Z","submitted_at":"2025-01-15T09:50:19Z","title":"Adaptive Data Augmentation with NaturalSpeech3 for Far-field Speaker Verification","version":1},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-08-10T20:25:17.248694Z"},"links":{"citing_paper":"/paper/2501.08691"},"observation_digest":"sha256:d2373f10c780ff0694cc8997b8e9660e62cdfafe9628fdf6cc083454eb98caa2","observation_id":"b0f26a8b-1cd6-4afd-959e-5226bbb0ef0c","resolution":{"observed_at":"2026-08-10T20:25:17.645044Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T20:25:17.625414Z","title":"Overcoming data scarcity in speaker identification: Dataset augmentation with synthetic mfccs via character-level rnn","venue":null,"work_id":"275103ba-5ce4-4658-9c5a-ced98b4e8ed3","year":2020},"citing_paper":{"arxiv_id":"2501.08691","last_updated":"2025-01-15T09:50:19Z","snapshot_observed_at":"2026-08-13T23:18:53.864836Z","submitted_at":"2025-01-15T09:50:19Z","title":"Adaptive Data Augmentation with NaturalSpeech3 for Far-field Speaker Verification","version":1},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-08-10T20:25:17.253223Z"},"links":{"citing_paper":"/paper/2501.08691"},"observation_digest":"sha256:cc79dbd9fa149e0be03ad1134767739edd1b9a9e3586a9ab94f5977b447a611b","observation_id":"4559d649-57e4-4143-bc22-815cad922439","resolution":{"observed_at":"2026-08-10T20:25:17.630364Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T20:25:17.611248Z","title":"Data augmentation using deep generative models for embedding based speaker recognition","venue":null,"work_id":"cd5daf6a-beb3-4a62-b498-11d999d31bca","year":2020},"citing_paper":{"arxiv_id":"2501.08691","last_updated":"2025-01-15T09:50:19Z","snapshot_observed_at":"2026-08-13T23:18:53.864836Z","submitted_at":"2025-01-15T09:50:19Z","title":"Adaptive Data Augmentation with NaturalSpeech3 for Far-field Speaker Verification","version":1},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-08-10T20:25:17.257698Z"},"links":{"citing_paper":"/paper/2501.08691"},"observation_digest":"sha256:3ed164f3fab1cb7c225d4139b74911efbd0a9bc9092a1933ce7e9c938d51afbd","observation_id":"1b162294-a0f0-4806-b654-8306b4797448","resolution":{"observed_at":"2026-08-10T20:25:17.615870Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T20:25:17.597355Z","title":"Data Aug- mentation Using Variational Autoencoder for Embedding Based Speaker Verification","venue":null,"work_id":"ad315962-34df-46af-be68-64ec80f6b9bd","year":2019},"citing_paper":{"arxiv_id":"2501.08691","last_updated":"2025-01-15T09:50:19Z","snapshot_observed_at":"2026-08-13T23:18:53.864836Z","submitted_at":"2025-01-15T09:50:19Z","title":"Adaptive Data Augmentation with NaturalSpeech3 for Far-field Speaker Verification","version":1},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-08-10T20:25:17.262615Z"},"links":{"citing_paper":"/paper/2501.08691"},"observation_digest":"sha256:60a5905f75d2055fe6fae5d4a916ba0a29a092020611c423c2d093ea838a674a","observation_id":"0783bf5d-5b27-4282-b881-f0b4a45f8e1c","resolution":{"observed_at":"2026-08-10T20:25:17.601870Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T20:25:17.583387Z","title":"Stargan-vc based cross- domain data augmentation for speaker verification","venue":null,"work_id":"b2e4451c-07b7-4f37-9ae1-8b41fe4140bf","year":2023},"citing_paper":{"arxiv_id":"2501.08691","last_updated":"2025-01-15T09:50:19Z","snapshot_observed_at":"2026-08-13T23:18:53.864836Z","submitted_at":"2025-01-15T09:50:19Z","title":"Adaptive Data Augmentation with NaturalSpeech3 for Far-field Speaker Verification","version":1},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-08-10T20:25:17.266943Z"},"links":{"citing_paper":"/paper/2501.08691"},"observation_digest":"sha256:197b93e56d28e24835387c3ff48a4d3b370269f6deb3f8f8b0265876ca031927","observation_id":"5f382f9e-99d8-4a98-a0fc-bc15f65fc0d7","resolution":{"observed_at":"2026-08-10T20:25:17.587994Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2005.07143","last_updated":"2020-08-10T13:50:24Z","snapshot_observed_at":"2026-08-16T12:49:35.884517Z","submitted_at":"2020-05-14T17:02:15Z","title":"ECAPA-TDNN: Emphasized Channel Attention, Propagation and Aggregation in TDNN Based Speaker Verification","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2005.07143","snapshot_observed_at":"2026-08-10T20:25:17.270988Z","title":"Ecapa- tdnn: Emphasized channel attention, propagation and aggregation in tdnn based speaker verification","venue":null,"work_id":null,"year":2005},"citing_paper":{"arxiv_id":"2501.08691","last_updated":"2025-01-15T09:50:19Z","snapshot_observed_at":"2026-08-13T23:18:53.864836Z","submitted_at":"2025-01-15T09:50:19Z","title":"Adaptive Data Augmentation with NaturalSpeech3 for Far-field Speaker Verification","version":1},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-08-10T20:25:17.270988Z"},"links":{"cited_paper":"/paper/2005.07143","citing_paper":"/paper/2501.08691"},"observation_digest":"sha256:e8bede30de7df66b14280b2b0119d64c629f69fcaf42f03a8f1ac7a7b3aefd85","observation_id":"71c21363-e3c0-44e4-a9fe-2ecaa9978b3b","resolution":{"observed_at":"2026-08-10T20:25:17.270988Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T20:25:17.275203Z","title":"Arcface: Additive angular margin loss for deep face recognition","venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2501.08691","last_updated":"2025-01-15T09:50:19Z","snapshot_observed_at":"2026-08-13T23:18:53.864836Z","submitted_at":"2025-01-15T09:50:19Z","title":"Adaptive Data Augmentation with NaturalSpeech3 for Far-field Speaker Verification","version":1},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-08-10T20:25:17.275203Z"},"links":{"citing_paper":"/paper/2501.08691"},"observation_digest":"sha256:6464a4e4bb19068ddd28d9177869ab78f5b62370bde962c6c7f6cc7bb89a27cb","observation_id":"82d55401-fefa-4ab1-82a8-2fb352a0e603","resolution":{"observed_at":"2026-08-10T20:25:17.275203Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1510.08484","last_updated":"2015-10-28T20:59:04Z","snapshot_observed_at":"2026-08-18T07:31:38.105834Z","submitted_at":"2015-10-28T20:59:04Z","title":"MUSAN: A Music, Speech, and Noise Corpus","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1510.08484","snapshot_observed_at":"2026-08-10T20:25:17.279531Z","title":"Musan: A music, speech, and noise corpus","venue":null,"work_id":null,"year":2015},"citing_paper":{"arxiv_id":"2501.08691","last_updated":"2025-01-15T09:50:19Z","snapshot_observed_at":"2026-08-13T23:18:53.864836Z","submitted_at":"2025-01-15T09:50:19Z","title":"Adaptive Data Augmentation with NaturalSpeech3 for Far-field Speaker Verification","version":1},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-08-10T20:25:17.279531Z"},"links":{"cited_paper":"/paper/1510.08484","citing_paper":"/paper/2501.08691"},"observation_digest":"sha256:512bc0f1ee2ae51cf801e0046412da219d06d30fc80861cb2958c3ac5f839f1a","observation_id":"db96e626-c3f9-42b1-a358-be851f347be4","resolution":{"observed_at":"2026-08-10T20:25:17.279531Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T20:25:17.558968Z","title":"Room impulse response generator","venue":null,"work_id":"75880d25-2b93-470f-ab95-ef9aa4553469","year":2006},"citing_paper":{"arxiv_id":"2501.08691","last_updated":"2025-01-15T09:50:19Z","snapshot_observed_at":"2026-08-13T23:18:53.864836Z","submitted_at":"2025-01-15T09:50:19Z","title":"Adaptive Data Augmentation with NaturalSpeech3 for Far-field Speaker Verification","version":1},"reference_index":36,"source":"pdf_text","source_observed_at":"2026-08-10T20:25:17.283774Z"},"links":{"citing_paper":"/paper/2501.08691"},"observation_digest":"sha256:843fa04762df6a3322e8bc318bfc12722462042cc083a8c4f569a4ce554c0631","observation_id":"cbec8dd2-aa82-468d-88ac-ae4769a64379","resolution":{"observed_at":"2026-08-10T20:25:17.564580Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T20:25:17.543625Z","title":"Speaker augmentation and bandwidth extension for deep speaker embedding","venue":null,"work_id":"92d5abc2-bd58-4970-bb1a-8b5b77497080","year":2019},"citing_paper":{"arxiv_id":"2501.08691","last_updated":"2025-01-15T09:50:19Z","snapshot_observed_at":"2026-08-13T23:18:53.864836Z","submitted_at":"2025-01-15T09:50:19Z","title":"Adaptive Data Augmentation with NaturalSpeech3 for Far-field Speaker Verification","version":1},"reference_index":37,"source":"pdf_text","source_observed_at":"2026-08-10T20:25:17.288452Z"},"links":{"citing_paper":"/paper/2501.08691"},"observation_digest":"sha256:32d056af62f7e573e374fd51a6a460d368eb6acf0d75bca5941649e756d615f3","observation_id":"74d30273-8485-45d4-892f-3acc35da86bd","resolution":{"observed_at":"2026-08-10T20:25:17.548203Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T20:25:17.527300Z","title":"Shuffleaug- ment: A data augmentation method using time shuffling","venue":null,"work_id":"051052fc-9f57-48bc-b80c-ba7e80a4279c","year":2023},"citing_paper":{"arxiv_id":"2501.08691","last_updated":"2025-01-15T09:50:19Z","snapshot_observed_at":"2026-08-13T23:18:53.864836Z","submitted_at":"2025-01-15T09:50:19Z","title":"Adaptive Data Augmentation with NaturalSpeech3 for Far-field Speaker Verification","version":1},"reference_index":38,"source":"pdf_text","source_observed_at":"2026-08-10T20:25:17.292680Z"},"links":{"citing_paper":"/paper/2501.08691"},"observation_digest":"sha256:b08db18743fdba50e83790d4306d24a2e9249e0acbcc2790d3829d0872621046","observation_id":"1b66f012-633f-42a2-a914-fa0120144cc3","resolution":{"observed_at":"2026-08-10T20:25:17.533341Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T20:25:17.512523Z","title":"Filteraugment: An acoustic environmental data augmentation method","venue":null,"work_id":"8ac68ddf-139c-4734-9430-cc7689935cdb","year":2022},"citing_paper":{"arxiv_id":"2501.08691","last_updated":"2025-01-15T09:50:19Z","snapshot_observed_at":"2026-08-13T23:18:53.864836Z","submitted_at":"2025-01-15T09:50:19Z","title":"Adaptive Data Augmentation with NaturalSpeech3 for Far-field Speaker Verification","version":1},"reference_index":39,"source":"pdf_text","source_observed_at":"2026-08-10T20:25:17.296891Z"},"links":{"citing_paper":"/paper/2501.08691"},"observation_digest":"sha256:fddaa9ea31af65eebdaba2d2046e96b40d2cfd45813b08ee15bf567001939a9c","observation_id":"25368803-858d-4961-b62d-940a723f9d32","resolution":{"observed_at":"2026-08-10T20:25:17.517080Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T20:25:17.498394Z","title":"Stargan-vc based cross- domain data augmentation for speaker verification","venue":null,"work_id":"0af918fa-7d6e-4934-9cf9-74c59289777a","year":2023},"citing_paper":{"arxiv_id":"2501.08691","last_updated":"2025-01-15T09:50:19Z","snapshot_observed_at":"2026-08-13T23:18:53.864836Z","submitted_at":"2025-01-15T09:50:19Z","title":"Adaptive Data Augmentation with NaturalSpeech3 for Far-field Speaker Verification","version":1},"reference_index":40,"source":"pdf_text","source_observed_at":"2026-08-10T20:25:17.300989Z"},"links":{"citing_paper":"/paper/2501.08691"},"observation_digest":"sha256:dfec6951554f39afe8c576dfa170ae7a9ac2d92c540ec97178efc7ffcf13bb7d","observation_id":"a3425cc2-0ed7-43f6-89c3-ef075f0317b3","resolution":{"observed_at":"2026-08-10T20:25:17.503050Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T20:25:17.483654Z","title":"Blind estimation of reverberation time","venue":null,"work_id":"d992edcd-a780-4f1f-af75-9d5a9abf9453","year":2003},"citing_paper":{"arxiv_id":"2501.08691","last_updated":"2025-01-15T09:50:19Z","snapshot_observed_at":"2026-08-13T23:18:53.864836Z","submitted_at":"2025-01-15T09:50:19Z","title":"Adaptive Data Augmentation with NaturalSpeech3 for Far-field Speaker Verification","version":1},"reference_index":41,"source":"pdf_text","source_observed_at":"2026-08-10T20:25:17.304984Z"},"links":{"citing_paper":"/paper/2501.08691"},"observation_digest":"sha256:ae377ffa99a8880ffbc0865b179c6f8f954b32a99a5ea315cbc7682b61651cfc","observation_id":"4f3d2d02-b3de-4b10-8441-76c23fa6b091","resolution":{"observed_at":"2026-08-10T20:25:17.488701Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}}],"paper":{"arxiv_id":"2501.08691","last_updated":"2025-01-15T09:50:19Z","latest_version":1,"primary_category":"cs.SD","snapshot_observed_at":"2026-08-13T23:18:53.864836Z","submitted_at":"2025-01-15T09:50:19Z","title":"Adaptive Data Augmentation with NaturalSpeech3 for Far-field Speaker Verification"},"reference_resolution":{"displayed":41,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":8,"verified_exact":3,"verified_fuzzy":30},"total_outbound_references":41},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"thesis":"As of 22 August 2026, this Paper Citation Record lists 41 of 41 outbound references and 0 inbound Pith citation observations for arXiv:2501.08691."}