{"as_of":"2026-08-19T05:12:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:43f85f55c968110afff0f483b1e14ce699f8be09fda8c437c73a5f8df606faa3","coverage":[{"denominator":49,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":49,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-07T14:58:52.074099Z","state":"measured"},{"denominator":50,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":50,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-18T06:34:40.430872+00:00","state":"measured"},{"denominator":1,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":1,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-07T14:58:45.905186Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"pith","source_observed_at":"2026-08-07T14:58:52.250127Z","state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2505.16798","last_updated":"2025-05-22T15:38:37Z","snapshot_observed_at":"2026-08-18T07:36:12.865850Z","submitted_at":"2025-05-22T15:38:37Z","title":"SEED: Speaker Embedding Enhancement Diffusion Model","version":1},"cited_work":{"arxiv_id":"2505.16798","doi":null,"metadata_source":"pith","pith_arxiv_id":"2505.16798","snapshot_observed_at":"2026-08-07T14:58:52.250127Z","title":"SEED: Speaker Embedding Enhancement Diffusion Model","venue":"eess.AS","work_id":"9e62e7aa-60de-4b6d-8982-e9aa8f59a5ed","year":2025},"citing_paper":{"arxiv_id":"2505.16798","last_updated":"2025-05-22T15:38:37Z","snapshot_observed_at":"2026-08-18T07:36:12.865850Z","submitted_at":"2025-05-22T15:38:37Z","title":"SEED: Speaker Embedding Enhancement Diffusion Model","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-07T14:58:45.905186Z"},"links":{"cited_paper":"/paper/2505.16798","citing_paper":"/paper/2505.16798"},"observation_digest":"sha256:a5586c243b7a24b4e8b9c0381e31cac1b698e3e5b7aa462f30d7ec1bc8e51595","observation_id":"9a2ed040-752f-4d40-b350-6c79888915c3","resolution":{"observed_at":"2026-08-07T14:58:52.419895Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}}],"links":{"evidence":"/evidence","html":"/paper/2505.16798/citation-record","integrity":"/paper/2505.16798/integrity","json":"/paper/2505.16798/citation-record.json","paper":"/paper/2505.16798"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:59:02.406407Z","title":null,"venue":null,"work_id":"a3c288ce-e52d-485e-9ab5-a9cda13450f2","year":null},"citing_paper":{"arxiv_id":"2505.16798","last_updated":"2025-05-22T15:38:37Z","snapshot_observed_at":"2026-08-18T07:36:12.865850Z","submitted_at":"2025-05-22T15:38:37Z","title":"SEED: Speaker Embedding Enhancement Diffusion Model","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-07T14:58:45.839015Z"},"links":{"citing_paper":"/paper/2505.16798"},"observation_digest":"sha256:d2c47198aa94daf1ea6f55744cdae4216f8414f9b566aed863667d920f7cf4cf","observation_id":"151921a1-b8f8-4001-b6fa-f7a90303ad54","resolution":{"observed_at":"2026-08-07T14:59:02.523660Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2505.16798","last_updated":"2025-05-22T15:38:37Z","snapshot_observed_at":"2026-08-18T07:36:12.865850Z","submitted_at":"2025-05-22T15:38:37Z","title":"SEED: Speaker Embedding Enhancement Diffusion Model","version":1},"cited_work":{"arxiv_id":"2505.16798","doi":null,"metadata_source":"pith","pith_arxiv_id":"2505.16798","snapshot_observed_at":"2026-08-07T14:58:52.250127Z","title":"SEED: Speaker Embedding Enhancement Diffusion Model","venue":"eess.AS","work_id":"9e62e7aa-60de-4b6d-8982-e9aa8f59a5ed","year":2025},"citing_paper":{"arxiv_id":"2505.16798","last_updated":"2025-05-22T15:38:37Z","snapshot_observed_at":"2026-08-18T07:36:12.865850Z","submitted_at":"2025-05-22T15:38:37Z","title":"SEED: Speaker Embedding Enhancement Diffusion Model","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-07T14:58:45.905186Z"},"links":{"cited_paper":"/paper/2505.16798","citing_paper":"/paper/2505.16798"},"observation_digest":"sha256:a5586c243b7a24b4e8b9c0381e31cac1b698e3e5b7aa462f30d7ec1bc8e51595","observation_id":"9a2ed040-752f-4d40-b350-6c79888915c3","resolution":{"observed_at":"2026-08-07T14:58:52.419895Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:59:02.159917Z","title":"The concept, process, and model structure of our methodology are shown in Figure 1","venue":null,"work_id":"a08a1607-c3cd-428e-ba79-e6561ad135c1","year":null},"citing_paper":{"arxiv_id":"2505.16798","last_updated":"2025-05-22T15:38:37Z","snapshot_observed_at":"2026-08-18T07:36:12.865850Z","submitted_at":"2025-05-22T15:38:37Z","title":"SEED: Speaker Embedding Enhancement Diffusion Model","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-07T14:58:46.041704Z"},"links":{"citing_paper":"/paper/2505.16798"},"observation_digest":"sha256:bf225d00efaf610e93aef711b44fc01e5f25f1e7e0f8f3d778fdd38efe07ab86","observation_id":"04127b2f-b406-40d6-ac06-ed2446999780","resolution":{"observed_at":"2026-08-07T14:59:02.282157Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:59:01.948764Z","title":"Model Configuration 4.1.1","venue":null,"work_id":"220e316c-527e-40dd-a5c5-5a61e7b15b7d","year":null},"citing_paper":{"arxiv_id":"2505.16798","last_updated":"2025-05-22T15:38:37Z","snapshot_observed_at":"2026-08-18T07:36:12.865850Z","submitted_at":"2025-05-22T15:38:37Z","title":"SEED: Speaker Embedding Enhancement Diffusion Model","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-07T14:58:46.204502Z"},"links":{"citing_paper":"/paper/2505.16798"},"observation_digest":"sha256:693a86407953c225cd07b1464f2f7cc4f8e75036cd4b712d63e0a822001f03b5","observation_id":"6f4f20cc-172b-45a7-a58e-3d9cf3324a78","resolution":{"observed_at":"2026-08-07T14:59:02.072511Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:59:01.492238Z","title":null,"venue":null,"work_id":"9b721c58-50da-4e05-add0-3b195d2f7e16","year":null},"citing_paper":{"arxiv_id":"2505.16798","last_updated":"2025-05-22T15:38:37Z","snapshot_observed_at":"2026-08-18T07:36:12.865850Z","submitted_at":"2025-05-22T15:38:37Z","title":"SEED: Speaker Embedding Enhancement Diffusion Model","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-07T14:58:46.463961Z"},"links":{"citing_paper":"/paper/2505.16798"},"observation_digest":"sha256:9bc6f6eae97ffd3147f72d1322358fa7a78e7220c328006d58338c33ab1b4a35","observation_id":"1227d4a9-9fe5-4d66-976b-10cef3131131","resolution":{"observed_at":"2026-08-07T14:59:01.578540Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:59:01.756563Z","title":"The SNR is randomly selected within 0–15 dB for background noise and 5–15 dB for music noise","venue":null,"work_id":"275ec955-29c0-4853-be17-8838d0922f56","year":null},"citing_paper":{"arxiv_id":"2505.16798","last_updated":"2025-05-22T15:38:37Z","snapshot_observed_at":"2026-08-18T07:36:12.865850Z","submitted_at":"2025-05-22T15:38:37Z","title":"SEED: Speaker Embedding Enhancement Diffusion Model","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-07T14:58:46.354460Z"},"links":{"citing_paper":"/paper/2505.16798"},"observation_digest":"sha256:dfe4bf9a60741575da04698612b00e4307877fffdd6c3f99b752d43fee0cf2bb","observation_id":"e64afc75-38e5-4fc6-a1bb-b9055a0689e6","resolution":{"observed_at":"2026-08-07T14:59:01.883523Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:59:01.240729Z","title":"It seamlessly integrates with pre-trained speaker recognition models, enabling immediate deployment in speaker recognition systems for real-world applications","venue":null,"work_id":"f86b47fd-f21d-4f36-a3ec-fcb1387f27c0","year":null},"citing_paper":{"arxiv_id":"2505.16798","last_updated":"2025-05-22T15:38:37Z","snapshot_observed_at":"2026-08-18T07:36:12.865850Z","submitted_at":"2025-05-22T15:38:37Z","title":"SEED: Speaker Embedding Enhancement Diffusion Model","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-07T14:58:46.587893Z"},"links":{"citing_paper":"/paper/2505.16798"},"observation_digest":"sha256:66b77e7e173ea139a67f124def2573b632ba745019cbe5b86b3b4fe6e4b269fd","observation_id":"3ec9afe0-3297-412a-a29b-9beb3bb5a0b0","resolution":{"observed_at":"2026-08-07T14:59:01.374546Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:59:00.973200Z","title":null,"venue":null,"work_id":"80f3bd9e-7280-40c3-a2d7-fdfedcf8cbef","year":2024},"citing_paper":{"arxiv_id":"2505.16798","last_updated":"2025-05-22T15:38:37Z","snapshot_observed_at":"2026-08-18T07:36:12.865850Z","submitted_at":"2025-05-22T15:38:37Z","title":"SEED: Speaker Embedding Enhancement Diffusion Model","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-07T14:58:46.693436Z"},"links":{"citing_paper":"/paper/2505.16798"},"observation_digest":"sha256:6bfc4c2bd9f701390d3cc7e8957d85fbd3f08a593be30044d4a88da8fd06dd2e","observation_id":"da568657-9617-4143-a994-ec5df7e95ede","resolution":{"observed_at":"2026-08-07T14:59:01.103880Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:59:00.687100Z","title":"Speaker recognition: A tutorial,","venue":null,"work_id":"dd0fe2e1-51e5-4b79-a02f-8960c3242a14","year":1997},"citing_paper":{"arxiv_id":"2505.16798","last_updated":"2025-05-22T15:38:37Z","snapshot_observed_at":"2026-08-18T07:36:12.865850Z","submitted_at":"2025-05-22T15:38:37Z","title":"SEED: Speaker Embedding Enhancement Diffusion Model","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-07T14:58:46.795808Z"},"links":{"citing_paper":"/paper/2505.16798"},"observation_digest":"sha256:595101fa6591f05da66b9c9030331df79a87618a3fe3ac195ce03a3a0d6fbe80","observation_id":"d72e78a9-c2d6-4ea1-a6cb-5cd54b2c7f2d","resolution":{"observed_at":"2026-08-07T14:59:00.817054Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:59:00.439655Z","title":"Disentangled representation learning for environment-agnostic speaker recognition,","venue":null,"work_id":"0d4b16d8-5330-4736-bdd9-edba587c5408","year":2024},"citing_paper":{"arxiv_id":"2505.16798","last_updated":"2025-05-22T15:38:37Z","snapshot_observed_at":"2026-08-18T07:36:12.865850Z","submitted_at":"2025-05-22T15:38:37Z","title":"SEED: Speaker Embedding Enhancement Diffusion Model","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-07T14:58:46.895134Z"},"links":{"citing_paper":"/paper/2505.16798"},"observation_digest":"sha256:d19b1d7deedade3b38bf7f3cedd3bbf2bbc887b502bbb578dbbd5fbb77615301","observation_id":"d102b145-19ae-4f7e-b870-853e4637a92f","resolution":{"observed_at":"2026-08-07T14:59:00.550661Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:58:47.033030Z","title":"V oxceleb: Large-scale speaker verification in the wild,","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2505.16798","last_updated":"2025-05-22T15:38:37Z","snapshot_observed_at":"2026-08-18T07:36:12.865850Z","submitted_at":"2025-05-22T15:38:37Z","title":"SEED: Speaker Embedding Enhancement Diffusion Model","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-07T14:58:47.033030Z"},"links":{"citing_paper":"/paper/2505.16798"},"observation_digest":"sha256:cd9117780afdb8fcb203a9840ddb904d83abc2bf185009f0488e0570358ccfe8","observation_id":"f6d22af8-5ac4-4d69-8cfd-ff9c7b651959","resolution":{"observed_at":"2026-08-07T14:58:47.033030Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:58:47.164905Z","title":"V oxCeleb2: Deep Speaker Recognition,","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2505.16798","last_updated":"2025-05-22T15:38:37Z","snapshot_observed_at":"2026-08-18T07:36:12.865850Z","submitted_at":"2025-05-22T15:38:37Z","title":"SEED: Speaker Embedding Enhancement Diffusion Model","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-07T14:58:47.164905Z"},"links":{"citing_paper":"/paper/2505.16798"},"observation_digest":"sha256:4d6dce5313ec0cf56e85266a04b2c694343031e9d7fd3ffee7e50ea29a5c8c41","observation_id":"1ec68968-257d-449e-8975-dc15a300effb","resolution":{"observed_at":"2026-08-07T14:58:47.164905Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1510.08484","last_updated":"2015-10-28T20:59:04Z","snapshot_observed_at":"2026-08-18T07:31:38.105834Z","submitted_at":"2015-10-28T20:59:04Z","title":"MUSAN: A Music, Speech, and Noise Corpus","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1510.08484","snapshot_observed_at":"2026-08-07T14:58:47.271712Z","title":"Musan: A music, speech, and noise corpus,","venue":null,"work_id":null,"year":2015},"citing_paper":{"arxiv_id":"2505.16798","last_updated":"2025-05-22T15:38:37Z","snapshot_observed_at":"2026-08-18T07:36:12.865850Z","submitted_at":"2025-05-22T15:38:37Z","title":"SEED: Speaker Embedding Enhancement Diffusion Model","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-07T14:58:47.271712Z"},"links":{"cited_paper":"/paper/1510.08484","citing_paper":"/paper/2505.16798"},"observation_digest":"sha256:75f0c74c8f7c275245286951738efd2bd8457f86bf1bb0eef92ffcdcdc1a4d1f","observation_id":"035a61bb-677f-485b-b181-4e1aabe66861","resolution":{"observed_at":"2026-08-07T14:58:47.271712Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:59:00.182462Z","title":"A study on data augmentation of reverberant speech for robust speech recognition,","venue":null,"work_id":"d5d2716d-c823-4b1d-bd99-cfb001e97260","year":2017},"citing_paper":{"arxiv_id":"2505.16798","last_updated":"2025-05-22T15:38:37Z","snapshot_observed_at":"2026-08-18T07:36:12.865850Z","submitted_at":"2025-05-22T15:38:37Z","title":"SEED: Speaker Embedding Enhancement Diffusion Model","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-07T14:58:47.392517Z"},"links":{"citing_paper":"/paper/2505.16798"},"observation_digest":"sha256:f1a51d42b2fb64ce7b0b0d242a8401a5bce9a7f1f885569bc6144cdb47d812cc","observation_id":"dd9817a7-3812-4657-a9a4-ebff16be2c82","resolution":{"observed_at":"2026-08-07T14:59:00.346032Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2211.11695","last_updated":"2024-06-26T19:29:39Z","snapshot_observed_at":"2026-08-16T16:14:27.081977Z","submitted_at":"2022-11-21T18:14:38Z","title":"Disentangled Representation Learning","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2211.11695","snapshot_observed_at":"2026-08-07T14:58:47.491212Z","title":"Disentangled representation learning,","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2505.16798","last_updated":"2025-05-22T15:38:37Z","snapshot_observed_at":"2026-08-18T07:36:12.865850Z","submitted_at":"2025-05-22T15:38:37Z","title":"SEED: Speaker Embedding Enhancement Diffusion Model","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-07T14:58:47.491212Z"},"links":{"cited_paper":"/paper/2211.11695","citing_paper":"/paper/2505.16798"},"observation_digest":"sha256:b7e8e20b7fef6d354f1e7b6ca2e5b8b4c661a69caf406c63d69dffa04a7222ca","observation_id":"fe46f6b9-3a4e-4d1c-864f-46612e7e7f26","resolution":{"observed_at":"2026-08-07T14:58:47.491212Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:58:59.904816Z","title":"Disentangled representation learning for multilingual speaker recognition,","venue":null,"work_id":"b6c4465e-ab01-4648-891e-be7c958eb840","year":2023},"citing_paper":{"arxiv_id":"2505.16798","last_updated":"2025-05-22T15:38:37Z","snapshot_observed_at":"2026-08-18T07:36:12.865850Z","submitted_at":"2025-05-22T15:38:37Z","title":"SEED: Speaker Embedding Enhancement Diffusion Model","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-07T14:58:47.606440Z"},"links":{"citing_paper":"/paper/2505.16798"},"observation_digest":"sha256:76c2f16599ba83668a7415d6592e6e33d33e14b9822ad3d6c088fe3aaee66291","observation_id":"801211fa-3e30-4229-86e6-d42eec508bf5","resolution":{"observed_at":"2026-08-07T14:59:00.046954Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:58:47.756888Z","title":"Denoising diffusion probabilistic models,","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2505.16798","last_updated":"2025-05-22T15:38:37Z","snapshot_observed_at":"2026-08-18T07:36:12.865850Z","submitted_at":"2025-05-22T15:38:37Z","title":"SEED: Speaker Embedding Enhancement Diffusion Model","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-07T14:58:47.756888Z"},"links":{"citing_paper":"/paper/2505.16798"},"observation_digest":"sha256:6a5b3ba5dc1c18d3618980831396f4336d3faa2ed6bec691a4d3c9ddc92d54c3","observation_id":"eb6c17de-de7b-4952-8f15-3b23d94ab273","resolution":{"observed_at":"2026-08-07T14:58:47.756888Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:58:59.670982Z","title":"Denoising diffusion implicit models,","venue":null,"work_id":"fe4dc67b-c175-4990-9abc-a8d2bfb17b8f","year":2021},"citing_paper":{"arxiv_id":"2505.16798","last_updated":"2025-05-22T15:38:37Z","snapshot_observed_at":"2026-08-18T07:36:12.865850Z","submitted_at":"2025-05-22T15:38:37Z","title":"SEED: Speaker Embedding Enhancement Diffusion Model","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-07T14:58:47.835306Z"},"links":{"citing_paper":"/paper/2505.16798"},"observation_digest":"sha256:71472ed5efc32a19a618fabbe712bfcb992bb8c6d2b9ffdb7d2a3f7dd4540345","observation_id":"d02a9561-8cd1-417e-a26c-ba60d0ac8b81","resolution":{"observed_at":"2026-08-07T14:58:59.807980Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2204.06125","last_updated":"2022-04-13T01:10:33Z","snapshot_observed_at":"2026-08-15T12:50:58.405488Z","submitted_at":"2022-04-13T01:10:33Z","title":"Hierarchical Text-Conditional Image Generation with CLIP Latents","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2204.06125","snapshot_observed_at":"2026-08-07T14:58:47.945788Z","title":"Hierarchi- cal text-conditional image generation with clip latents,","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2505.16798","last_updated":"2025-05-22T15:38:37Z","snapshot_observed_at":"2026-08-18T07:36:12.865850Z","submitted_at":"2025-05-22T15:38:37Z","title":"SEED: Speaker Embedding Enhancement Diffusion Model","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-07T14:58:47.945788Z"},"links":{"cited_paper":"/paper/2204.06125","citing_paper":"/paper/2505.16798"},"observation_digest":"sha256:0bdaf5cde1c3da40547bcd311b697041940551efa8634e7de6cd73bef7ce662f","observation_id":"b05ff368-253d-4aef-af28-18fee70d513b","resolution":{"observed_at":"2026-08-07T14:58:47.945788Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:58:59.431922Z","title":"High-resolution image synthesis with latent diffusion models,","venue":null,"work_id":"35825fc5-f0e2-47bc-b0ef-81a8c62e6ad7","year":2022},"citing_paper":{"arxiv_id":"2505.16798","last_updated":"2025-05-22T15:38:37Z","snapshot_observed_at":"2026-08-18T07:36:12.865850Z","submitted_at":"2025-05-22T15:38:37Z","title":"SEED: Speaker Embedding Enhancement Diffusion Model","version":1},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-07T14:58:48.093320Z"},"links":{"citing_paper":"/paper/2505.16798"},"observation_digest":"sha256:26ada93ab6091b9c1bc98cfa0036750b1eee6140893eb3d158db9325a1a12b3b","observation_id":"3cb16d64-5515-43fb-a125-d90c3c073001","resolution":{"observed_at":"2026-08-07T14:58:59.552203Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:58:59.161416Z","title":"Audioldm: text-to-audio generation with latent diffusion models,","venue":null,"work_id":"24152911-a5bc-478f-985a-246439f247c4","year":2023},"citing_paper":{"arxiv_id":"2505.16798","last_updated":"2025-05-22T15:38:37Z","snapshot_observed_at":"2026-08-18T07:36:12.865850Z","submitted_at":"2025-05-22T15:38:37Z","title":"SEED: Speaker Embedding Enhancement Diffusion Model","version":1},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-07T14:58:48.222472Z"},"links":{"citing_paper":"/paper/2505.16798"},"observation_digest":"sha256:1c979b441a69d5befa94c62ef206b92d54252dee3613e1865473d8614028c8bb","observation_id":"b812bce6-c714-4507-ae85-0f747448f5e4","resolution":{"observed_at":"2026-08-07T14:58:59.318343Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:58:58.896323Z","title":"Suppression of acoustic noise in speech using spectral subtraction,","venue":null,"work_id":"01500b6e-985b-474f-8f46-ec8f624aa0fb","year":1979},"citing_paper":{"arxiv_id":"2505.16798","last_updated":"2025-05-22T15:38:37Z","snapshot_observed_at":"2026-08-18T07:36:12.865850Z","submitted_at":"2025-05-22T15:38:37Z","title":"SEED: Speaker Embedding Enhancement Diffusion Model","version":1},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-07T14:58:48.362110Z"},"links":{"citing_paper":"/paper/2505.16798"},"observation_digest":"sha256:0a59ab93f12ec149e18e2cacbe6bc6ae8283cdf1175314090ae2e93c118a2fd2","observation_id":"1dc2c5c6-8251-40f8-a5d5-31679d995d4f","resolution":{"observed_at":"2026-08-07T14:58:59.001025Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:58:58.610802Z","title":"Enhancement and bandwidth compression of noisy speech,","venue":null,"work_id":"e4d70eb2-c468-46ca-8cc1-45139aa82480","year":1979},"citing_paper":{"arxiv_id":"2505.16798","last_updated":"2025-05-22T15:38:37Z","snapshot_observed_at":"2026-08-18T07:36:12.865850Z","submitted_at":"2025-05-22T15:38:37Z","title":"SEED: Speaker Embedding Enhancement Diffusion Model","version":1},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-07T14:58:48.486451Z"},"links":{"citing_paper":"/paper/2505.16798"},"observation_digest":"sha256:52a455264be500e28e7eae5b11d2f9c4a20cc522f1b89f32fdb9ead79fd377af","observation_id":"ff49cc2f-9c9c-4287-b407-38d664eb0b21","resolution":{"observed_at":"2026-08-07T14:58:58.768191Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:58:58.359476Z","title":"Speech enhancement using a minimum- mean square error short-time spectral amplitude estimator,","venue":null,"work_id":"792453fd-e025-415e-b799-5ad9345666fd","year":1984},"citing_paper":{"arxiv_id":"2505.16798","last_updated":"2025-05-22T15:38:37Z","snapshot_observed_at":"2026-08-18T07:36:12.865850Z","submitted_at":"2025-05-22T15:38:37Z","title":"SEED: Speaker Embedding Enhancement Diffusion Model","version":1},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-07T14:58:48.640547Z"},"links":{"citing_paper":"/paper/2505.16798"},"observation_digest":"sha256:4d5a9f3b0e0261dbaa74f51ccd47fa32776c9ee3471a68f916d1786151c80654","observation_id":"3a36315e-b815-40f5-a18f-ef660e979cff","resolution":{"observed_at":"2026-08-07T14:58:58.471138Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:58:58.106477Z","title":"Speech enhancement based on deep denoising autoencoder","venue":null,"work_id":"b9442551-dba6-4981-a80d-9f9d00f51e3a","year":2013},"citing_paper":{"arxiv_id":"2505.16798","last_updated":"2025-05-22T15:38:37Z","snapshot_observed_at":"2026-08-18T07:36:12.865850Z","submitted_at":"2025-05-22T15:38:37Z","title":"SEED: Speaker Embedding Enhancement Diffusion Model","version":1},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-08-07T14:58:48.790473Z"},"links":{"citing_paper":"/paper/2505.16798"},"observation_digest":"sha256:d3588da561e09cf99febb98a45cd4329132d954c9f9acd0e08ea23d7fe79e24b","observation_id":"aa78f462-3243-4cc3-9f05-4809e9716f94","resolution":{"observed_at":"2026-08-07T14:58:58.234859Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:58:57.886891Z","title":"A new framework for cnn-based speech enhancement in the time domain,","venue":null,"work_id":"a57e549c-5c12-426b-aba5-4bc31f1e8050","year":2019},"citing_paper":{"arxiv_id":"2505.16798","last_updated":"2025-05-22T15:38:37Z","snapshot_observed_at":"2026-08-18T07:36:12.865850Z","submitted_at":"2025-05-22T15:38:37Z","title":"SEED: Speaker Embedding Enhancement Diffusion Model","version":1},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-08-07T14:58:48.918712Z"},"links":{"citing_paper":"/paper/2505.16798"},"observation_digest":"sha256:0681c3c369c404017c31adc879e5f321fad41208c40f3ea46cd542c5e014f58d","observation_id":"dab1bf09-8ebf-4729-b785-2c24aac1f534","resolution":{"observed_at":"2026-08-07T14:58:57.974513Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:58:57.567212Z","title":"Segan: Speech enhancement generative adversarial network,","venue":null,"work_id":"43f20dc7-cae3-4e02-bafd-899668297565","year":2017},"citing_paper":{"arxiv_id":"2505.16798","last_updated":"2025-05-22T15:38:37Z","snapshot_observed_at":"2026-08-18T07:36:12.865850Z","submitted_at":"2025-05-22T15:38:37Z","title":"SEED: Speaker Embedding Enhancement Diffusion Model","version":1},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-08-07T14:58:49.042300Z"},"links":{"citing_paper":"/paper/2505.16798"},"observation_digest":"sha256:a7e02aeed4f0e700b1cff6927f2c8466797e5815faa8bdf6b2088101f0aff5fe","observation_id":"c9fb40ff-acca-45a0-968c-21c612d12d39","resolution":{"observed_at":"2026-08-07T14:58:57.724025Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:58:57.317280Z","title":"A variance modeling framework based on variational autoencoders for speech enhancement,","venue":null,"work_id":"712d0b1b-e548-454d-9f39-6bdcb8cb2a41","year":2018},"citing_paper":{"arxiv_id":"2505.16798","last_updated":"2025-05-22T15:38:37Z","snapshot_observed_at":"2026-08-18T07:36:12.865850Z","submitted_at":"2025-05-22T15:38:37Z","title":"SEED: Speaker Embedding Enhancement Diffusion Model","version":1},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-08-07T14:58:49.167494Z"},"links":{"citing_paper":"/paper/2505.16798"},"observation_digest":"sha256:cdc30cdb1027ff7b99babaaac7693862ca327e965aba610110e910dc6c2d5c3a","observation_id":"66eecd39-056d-44d9-8be0-dc1455e45e94","resolution":{"observed_at":"2026-08-07T14:58:57.454916Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:58:57.060252Z","title":"Speech enhancement with score-based generative models in the complex stft domain,","venue":null,"work_id":"91749c19-7a2d-4081-9b78-86264a30e604","year":2022},"citing_paper":{"arxiv_id":"2505.16798","last_updated":"2025-05-22T15:38:37Z","snapshot_observed_at":"2026-08-18T07:36:12.865850Z","submitted_at":"2025-05-22T15:38:37Z","title":"SEED: Speaker Embedding Enhancement Diffusion Model","version":1},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-08-07T14:58:49.292968Z"},"links":{"citing_paper":"/paper/2505.16798"},"observation_digest":"sha256:d605ce6c8633d3ec5744e6fa1efaf5f61082002c27515d70c951f26ddbbe26bd","observation_id":"47492a07-ef13-44bd-a9f4-612969f4d7b7","resolution":{"observed_at":"2026-08-07T14:58:57.190676Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:58:56.747246Z","title":"How bad are artifacts?: Analyzing the impact of speech enhancement errors on asr,","venue":null,"work_id":"01a9dd95-d72c-47a3-aa19-e76f659e09d1","year":2022},"citing_paper":{"arxiv_id":"2505.16798","last_updated":"2025-05-22T15:38:37Z","snapshot_observed_at":"2026-08-18T07:36:12.865850Z","submitted_at":"2025-05-22T15:38:37Z","title":"SEED: Speaker Embedding Enhancement Diffusion Model","version":1},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-08-07T14:58:49.423046Z"},"links":{"citing_paper":"/paper/2505.16798"},"observation_digest":"sha256:6e9973fba40516117c672e3f9ad365654ac382eb809df8a6c06c3745cee845a2","observation_id":"9681be54-01c5-47e3-9e35-c5bc55a5bea7","resolution":{"observed_at":"2026-08-07T14:58:56.890430Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:58:56.506889Z","title":"Audio enhancing with dnn autoencoder for speaker recognition,","venue":null,"work_id":"8fac759c-73b6-457d-bd3e-faec11406fe4","year":2016},"citing_paper":{"arxiv_id":"2505.16798","last_updated":"2025-05-22T15:38:37Z","snapshot_observed_at":"2026-08-18T07:36:12.865850Z","submitted_at":"2025-05-22T15:38:37Z","title":"SEED: Speaker Embedding Enhancement Diffusion Model","version":1},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-08-07T14:58:49.527248Z"},"links":{"citing_paper":"/paper/2505.16798"},"observation_digest":"sha256:c57e5e713ce77f3b795fb691af42ce7d2fc16365af08a1fef4bd876953d91246","observation_id":"1e6c2ecd-f66d-4e8d-a508-22df5c104a17","resolution":{"observed_at":"2026-08-07T14:58:56.648137Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:58:56.251984Z","title":"Front-end speech enhancement for commercial speaker verification systems,","venue":null,"work_id":"388ef4bd-7308-498a-93f3-027ad3aa8728","year":2018},"citing_paper":{"arxiv_id":"2505.16798","last_updated":"2025-05-22T15:38:37Z","snapshot_observed_at":"2026-08-18T07:36:12.865850Z","submitted_at":"2025-05-22T15:38:37Z","title":"SEED: Speaker Embedding Enhancement Diffusion Model","version":1},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-08-07T14:58:49.713951Z"},"links":{"citing_paper":"/paper/2505.16798"},"observation_digest":"sha256:d4b2a50ea8181d16970ea172ae4f8912779f80656a41d8218abfa67b1a6654b0","observation_id":"612b79e4-ecd7-483d-9fa7-a085acc1b8e0","resolution":{"observed_at":"2026-08-07T14:58:56.358358Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:58:56.015705Z","title":"Joint feature en- hancement and speaker recognition with multi-objective task-oriented network","venue":null,"work_id":"588b908b-37f4-4aa4-8bf6-400cc53d0398","year":2021},"citing_paper":{"arxiv_id":"2505.16798","last_updated":"2025-05-22T15:38:37Z","snapshot_observed_at":"2026-08-18T07:36:12.865850Z","submitted_at":"2025-05-22T15:38:37Z","title":"SEED: Speaker Embedding Enhancement Diffusion Model","version":1},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-08-07T14:58:49.846457Z"},"links":{"citing_paper":"/paper/2505.16798"},"observation_digest":"sha256:789661b1e4be30e829be7568275c33f72c9ffeab321467612944e0127c9f8bfc","observation_id":"0651d02a-10e3-4958-a8df-4884fcd5a6a6","resolution":{"observed_at":"2026-08-07T14:58:56.144604Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:58:55.787000Z","title":"Analysis of i-vector length normalization in speaker recognition systems","venue":null,"work_id":"e57f366f-bd9b-49e2-a36d-fb0ac2979a90","year":2011},"citing_paper":{"arxiv_id":"2505.16798","last_updated":"2025-05-22T15:38:37Z","snapshot_observed_at":"2026-08-18T07:36:12.865850Z","submitted_at":"2025-05-22T15:38:37Z","title":"SEED: Speaker Embedding Enhancement Diffusion Model","version":1},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-08-07T14:58:50.006635Z"},"links":{"citing_paper":"/paper/2505.16798"},"observation_digest":"sha256:c459a98c98ce133c325ec4532289f51531a8dcf9db0f7a37bdbaf852b8c6c1bd","observation_id":"fd6d7747-ce5e-4617-a6b8-b295b86b56bd","resolution":{"observed_at":"2026-08-07T14:58:55.923433Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:58:55.515002Z","title":"Selective deep speaker embedding enhancement for speaker verification,","venue":null,"work_id":"6af06d6d-8b70-40b0-b037-300e094da0a7","year":2020},"citing_paper":{"arxiv_id":"2505.16798","last_updated":"2025-05-22T15:38:37Z","snapshot_observed_at":"2026-08-18T07:36:12.865850Z","submitted_at":"2025-05-22T15:38:37Z","title":"SEED: Speaker Embedding Enhancement Diffusion Model","version":1},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-08-07T14:58:50.148482Z"},"links":{"citing_paper":"/paper/2505.16798"},"observation_digest":"sha256:1ed8ab1481e6166000db754750f916a450dbd642e4c9b8ad5398bfecdeb9be3b","observation_id":"e8fabee0-5c3a-43e0-a32e-6f9657e23eca","resolution":{"observed_at":"2026-08-07T14:58:55.614152Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:58:55.353290Z","title":"The ins and outs of speaker recognition: lessons from V oxSRC 2020,","venue":null,"work_id":"95e23c86-8882-4902-83d3-6b3734f14df9","year":2020},"citing_paper":{"arxiv_id":"2505.16798","last_updated":"2025-05-22T15:38:37Z","snapshot_observed_at":"2026-08-18T07:36:12.865850Z","submitted_at":"2025-05-22T15:38:37Z","title":"SEED: Speaker Embedding Enhancement Diffusion Model","version":1},"reference_index":36,"source":"pdf_text","source_observed_at":"2026-08-07T14:58:50.290068Z"},"links":{"citing_paper":"/paper/2505.16798"},"observation_digest":"sha256:24feb54ffca52789df7716012d5a6e5cc851ee2b611e5a75ac92a177aaf9842e","observation_id":"fea8791a-0bc9-4831-9787-954beb2e94ae","resolution":{"observed_at":"2026-08-07T14:58:55.436313Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:58:55.044745Z","title":"ECAPA-TDNN: Emphasized channel attention, propagation and aggregation in tdnn based speaker verification,","venue":null,"work_id":"6bb7d119-52c0-4d10-99b1-920223dd033b","year":2020},"citing_paper":{"arxiv_id":"2505.16798","last_updated":"2025-05-22T15:38:37Z","snapshot_observed_at":"2026-08-18T07:36:12.865850Z","submitted_at":"2025-05-22T15:38:37Z","title":"SEED: Speaker Embedding Enhancement Diffusion Model","version":1},"reference_index":37,"source":"pdf_text","source_observed_at":"2026-08-07T14:58:50.392006Z"},"links":{"citing_paper":"/paper/2505.16798"},"observation_digest":"sha256:a32d1c13367dec736aa2075d66f95bdc3429ee1fe964d92e118382aa45768259","observation_id":"8b142e74-9560-4e32-b10f-2fee55f9690f","resolution":{"observed_at":"2026-08-07T14:58:55.161007Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:58:54.766307Z","title":"Wavlm: Large-scale self-supervised pre-training for full stack speech processing,","venue":null,"work_id":"085df1b0-995e-40ff-899a-96915ae3d722","year":2022},"citing_paper":{"arxiv_id":"2505.16798","last_updated":"2025-05-22T15:38:37Z","snapshot_observed_at":"2026-08-18T07:36:12.865850Z","submitted_at":"2025-05-22T15:38:37Z","title":"SEED: Speaker Embedding Enhancement Diffusion Model","version":1},"reference_index":38,"source":"pdf_text","source_observed_at":"2026-08-07T14:58:50.551287Z"},"links":{"citing_paper":"/paper/2505.16798"},"observation_digest":"sha256:ee5d4b9e5bfd74776f79023fbb93513f273d0b8df96940586e92a1df7f226466","observation_id":"05b5a33e-a1d5-494e-80c5-722a96c97fe4","resolution":{"observed_at":"2026-08-07T14:58:54.910704Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:58:54.535673Z","title":"Real time speech enhancement in the waveform domain,","venue":null,"work_id":"48c21ebe-5ebd-40cf-90c3-f0cdc9c3e3d7","year":2020},"citing_paper":{"arxiv_id":"2505.16798","last_updated":"2025-05-22T15:38:37Z","snapshot_observed_at":"2026-08-18T07:36:12.865850Z","submitted_at":"2025-05-22T15:38:37Z","title":"SEED: Speaker Embedding Enhancement Diffusion Model","version":1},"reference_index":39,"source":"pdf_text","source_observed_at":"2026-08-07T14:58:50.657659Z"},"links":{"citing_paper":"/paper/2505.16798"},"observation_digest":"sha256:80445cbb45c9c08bea3b85c8dca0401bc13da36cae8b97dc3eddc69ee94184a0","observation_id":"a82bb7b3-c26d-4b38-822a-447a612427f3","resolution":{"observed_at":"2026-08-07T14:58:54.662133Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:58:54.274294Z","title":"Return of unconditional generation: A self-supervised representation generation method,","venue":null,"work_id":"5ef4ac74-95b6-4674-a928-7295e4ecd9c7","year":2024},"citing_paper":{"arxiv_id":"2505.16798","last_updated":"2025-05-22T15:38:37Z","snapshot_observed_at":"2026-08-18T07:36:12.865850Z","submitted_at":"2025-05-22T15:38:37Z","title":"SEED: Speaker Embedding Enhancement Diffusion Model","version":1},"reference_index":40,"source":"pdf_text","source_observed_at":"2026-08-07T14:58:50.792468Z"},"links":{"citing_paper":"/paper/2505.16798"},"observation_digest":"sha256:8f8ed6465589d0da8e60481726fdadd461f71c2f0416ebe86b9f7a4297700481","observation_id":"42cfc860-03f1-42d2-b54a-b0651eb34db1","resolution":{"observed_at":"2026-08-07T14:58:54.374486Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:58:54.052893Z","title":"Layer normalization,","venue":null,"work_id":"cfdd18e7-4ce6-4e98-956c-82f3607be9c1","year":2016},"citing_paper":{"arxiv_id":"2505.16798","last_updated":"2025-05-22T15:38:37Z","snapshot_observed_at":"2026-08-18T07:36:12.865850Z","submitted_at":"2025-05-22T15:38:37Z","title":"SEED: Speaker Embedding Enhancement Diffusion Model","version":1},"reference_index":41,"source":"pdf_text","source_observed_at":"2026-08-07T14:58:50.905731Z"},"links":{"citing_paper":"/paper/2505.16798"},"observation_digest":"sha256:6f933d20ad776f6cec5cee62203472cd3755d9c9ac33479377bc476db8a71984","observation_id":"ce991142-887d-4e76-8840-c46ae5ae888c","resolution":{"observed_at":"2026-08-07T14:58:54.157190Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:58:51.038151Z","title":"Sigmoid-weighted linear units for neural network function approximation in reinforcement learning,","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2505.16798","last_updated":"2025-05-22T15:38:37Z","snapshot_observed_at":"2026-08-18T07:36:12.865850Z","submitted_at":"2025-05-22T15:38:37Z","title":"SEED: Speaker Embedding Enhancement Diffusion Model","version":1},"reference_index":42,"source":"pdf_text","source_observed_at":"2026-08-07T14:58:51.038151Z"},"links":{"citing_paper":"/paper/2505.16798"},"observation_digest":"sha256:ee49d6bb1c44f84c3746c73c60888accf1799b04d91d1d6bf3e607e146a1126f","observation_id":"273afe02-a358-4985-820a-8ce972180f6e","resolution":{"observed_at":"2026-08-07T14:58:51.038151Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:58:53.891335Z","title":"Libritts-r: A restored multi-speaker text-to-speech corpus,","venue":null,"work_id":"34ba26e2-a2c7-42dd-b94d-f035c1559433","year":2023},"citing_paper":{"arxiv_id":"2505.16798","last_updated":"2025-05-22T15:38:37Z","snapshot_observed_at":"2026-08-18T07:36:12.865850Z","submitted_at":"2025-05-22T15:38:37Z","title":"SEED: Speaker Embedding Enhancement Diffusion Model","version":1},"reference_index":43,"source":"pdf_text","source_observed_at":"2026-08-07T14:58:51.195296Z"},"links":{"citing_paper":"/paper/2505.16798"},"observation_digest":"sha256:73e6941cf4fba8aa340fc52f98e31e85bf4ebc64e7de60b84b4779eb93502205","observation_id":"24d10349-dede-41ce-816b-ab67ca9f3db7","resolution":{"observed_at":"2026-08-07T14:58:53.953644Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:58:53.556180Z","title":"Libri-light: A benchmark for asr with limited or no supervision,","venue":null,"work_id":"e4b2944d-6179-4692-aac1-a46663dab8d4","year":2020},"citing_paper":{"arxiv_id":"2505.16798","last_updated":"2025-05-22T15:38:37Z","snapshot_observed_at":"2026-08-18T07:36:12.865850Z","submitted_at":"2025-05-22T15:38:37Z","title":"SEED: Speaker Embedding Enhancement Diffusion Model","version":1},"reference_index":44,"source":"pdf_text","source_observed_at":"2026-08-07T14:58:51.350809Z"},"links":{"citing_paper":"/paper/2505.16798"},"observation_digest":"sha256:398505a7eeca6bddffc0237af2038296a0cfbdf3fa57a97c7fd624587b9defb4","observation_id":"f09a3121-0ca7-4cf6-bfc0-a7c3823b3871","resolution":{"observed_at":"2026-08-07T14:58:53.713522Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:58:53.306755Z","title":"The vox celeb speaker recognition challenge: A retrospective,","venue":null,"work_id":"943dd0fa-cc8d-4210-b9c5-e11192ef4b85","year":2024},"citing_paper":{"arxiv_id":"2505.16798","last_updated":"2025-05-22T15:38:37Z","snapshot_observed_at":"2026-08-18T07:36:12.865850Z","submitted_at":"2025-05-22T15:38:37Z","title":"SEED: Speaker Embedding Enhancement Diffusion Model","version":1},"reference_index":45,"source":"pdf_text","source_observed_at":"2026-08-07T14:58:51.509396Z"},"links":{"citing_paper":"/paper/2505.16798"},"observation_digest":"sha256:7fb7f6799936bfa8afd9f62813eeccbf57e8a143f6d4bd0c18bc97f03cc948a9","observation_id":"093a90fa-6dd7-437e-8f24-4dddb3970260","resolution":{"observed_at":"2026-08-07T14:58:53.429215Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:58:53.082994Z","title":"Rethinking session variability: Leveraging session embeddings for session robustness in speaker verification,","venue":null,"work_id":"64a80173-3998-46d9-a584-3660271d997c","year":2023},"citing_paper":{"arxiv_id":"2505.16798","last_updated":"2025-05-22T15:38:37Z","snapshot_observed_at":"2026-08-18T07:36:12.865850Z","submitted_at":"2025-05-22T15:38:37Z","title":"SEED: Speaker Embedding Enhancement Diffusion Model","version":1},"reference_index":46,"source":"pdf_text","source_observed_at":"2026-08-07T14:58:51.643238Z"},"links":{"citing_paper":"/paper/2505.16798"},"observation_digest":"sha256:4f20f6c6b2424620954103f243c5683f88c022c0d086f53c54d9d11afa1f6f14","observation_id":"e08378df-50e7-4442-bf72-f056e211e06a","resolution":{"observed_at":"2026-08-07T14:58:53.202701Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:58:52.808226Z","title":"Pytorch: An imperative style, high-performance deep learning library,","venue":null,"work_id":"d833c729-830d-4f78-9da3-66711ed14fc1","year":2019},"citing_paper":{"arxiv_id":"2505.16798","last_updated":"2025-05-22T15:38:37Z","snapshot_observed_at":"2026-08-18T07:36:12.865850Z","submitted_at":"2025-05-22T15:38:37Z","title":"SEED: Speaker Embedding Enhancement Diffusion Model","version":1},"reference_index":47,"source":"pdf_text","source_observed_at":"2026-08-07T14:58:51.799950Z"},"links":{"citing_paper":"/paper/2505.16798"},"observation_digest":"sha256:325f90d996470f35dbb1eef19fc2dc077d17f34aeae701af7307a1f6a6b3954d","observation_id":"6affdd73-9ef5-4055-bc98-1791fc3ea8c6","resolution":{"observed_at":"2026-08-07T14:58:52.942677Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:58:51.932328Z","title":"Decoupled weight decay regularization,","venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2505.16798","last_updated":"2025-05-22T15:38:37Z","snapshot_observed_at":"2026-08-18T07:36:12.865850Z","submitted_at":"2025-05-22T15:38:37Z","title":"SEED: Speaker Embedding Enhancement Diffusion Model","version":1},"reference_index":48,"source":"pdf_text","source_observed_at":"2026-08-07T14:58:51.932328Z"},"links":{"citing_paper":"/paper/2505.16798"},"observation_digest":"sha256:95302f23f7f95c20fbd14296f3a3a3d76bfcb74ef843844df7d769b43829ab08","observation_id":"675f3468-89cb-483c-ac96-5623ad9b6fbe","resolution":{"observed_at":"2026-08-07T14:58:51.932328Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:58:52.594324Z","title":"The 2018 nist speaker recognition evaluation,","venue":null,"work_id":"c9d44eb0-f3f0-4ae2-9db7-339e695cbf6c","year":2018},"citing_paper":{"arxiv_id":"2505.16798","last_updated":"2025-05-22T15:38:37Z","snapshot_observed_at":"2026-08-18T07:36:12.865850Z","submitted_at":"2025-05-22T15:38:37Z","title":"SEED: Speaker Embedding Enhancement Diffusion Model","version":1},"reference_index":49,"source":"pdf_text","source_observed_at":"2026-08-07T14:58:52.074099Z"},"links":{"citing_paper":"/paper/2505.16798"},"observation_digest":"sha256:3488503ad61d361cd71893dad4e359601f80da0fb035724c414c4966c831f6b3","observation_id":"db11615d-6c87-4147-9b51-acdd46c55e53","resolution":{"observed_at":"2026-08-07T14:58:52.655643Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}}],"paper":{"arxiv_id":"2505.16798","last_updated":"2025-05-22T15:38:37Z","latest_version":1,"primary_category":"eess.AS","snapshot_observed_at":"2026-08-18T07:36:12.865850Z","submitted_at":"2025-05-22T15:38:37Z","title":"SEED: Speaker Embedding Enhancement Diffusion Model"},"reference_resolution":{"displayed":49,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":11,"verified_exact":1,"verified_fuzzy":37},"total_outbound_references":49},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"thesis":"As of 19 August 2026, this Paper Citation Record lists 49 of 49 outbound references and 1 inbound Pith citation observation for arXiv:2505.16798."}