{"as_of":"2026-08-09T07:30:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:7d98c3064e1a2d3476798fcdcab5f2b0c728c267d26f6323315a22c5da3cbe2c","coverage":[{"denominator":29,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":29,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-06T13:47:43.772071Z","state":"measured"},{"denominator":29,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":29,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-09T06:31:02.800959+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2507.20140/citation-record","integrity":"/paper/2507.20140/integrity","json":"/paper/2507.20140/citation-record.json","paper":"/paper/2507.20140"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T13:47:44.767995Z","title":null,"venue":null,"work_id":"d2ee0e82-724b-44e5-b41a-c2fa241e9f32","year":2022},"citing_paper":{"arxiv_id":"2507.20140","last_updated":"2025-07-27T06:13:58Z","snapshot_observed_at":"2026-08-08T00:44:57.011547Z","submitted_at":"2025-07-27T06:13:58Z","title":"Do Not Mimic My Voice: Speaker Identity Unlearning for Zero-Shot Text-to-Speech","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-06T13:47:43.633765Z"},"links":{"citing_paper":"/paper/2507.20140"},"observation_digest":"sha256:e3bfdd6495828e36a08574fcf96f9931a5d8feac8fd943334fff26b6e156ca74","observation_id":"d40a9b31-c119-4ed0-88b8-21dc5ebb35a5","resolution":{"observed_at":"2026-08-06T13:47:44.827950Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T13:47:41.949882Z","title":"doi: 10.1609/aaai.v37i6.25879","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2507.20140","last_updated":"2025-07-27T06:13:58Z","snapshot_observed_at":"2026-08-08T00:44:57.011547Z","submitted_at":"2025-07-27T06:13:58Z","title":"Do Not Mimic My Voice: Speaker Identity Unlearning for Zero-Shot Text-to-Speech","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-06T13:47:41.949882Z"},"links":{"citing_paper":"/paper/2507.20140"},"observation_digest":"sha256:1afe2b4bb595bdd60b3768e18d8fde72806444c89a5172bb67c0c14102d9fa6c","observation_id":"b29818ce-0729-4898-a85e-273c51b2fe3a","resolution":{"observed_at":"2026-08-06T13:47:41.949882Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T13:47:42.054073Z","title":"doi: 10.18653/v1/2023.acl-long.805","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2507.20140","last_updated":"2025-07-27T06:13:58Z","snapshot_observed_at":"2026-08-08T00:44:57.011547Z","submitted_at":"2025-07-27T06:13:58Z","title":"Do Not Mimic My Voice: Speaker Identity Unlearning for Zero-Shot Text-to-Speech","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-06T13:47:42.054073Z"},"links":{"citing_paper":"/paper/2507.20140"},"observation_digest":"sha256:c7578c5d7bdd24533885fe2f60ec00e05d4dbb15f42995fe602611d53e4dacc6","observation_id":"6ac6d32b-ed8b-4adf-be23-e5b026d2a0af","resolution":{"observed_at":"2026-08-06T13:47:42.054073Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T13:47:47.394351Z","title":"Libri-light: A benchmark for asr with limited or no supervision","venue":null,"work_id":"aee54d6b-eb98-45d9-befc-07da1d68f011","year":2020},"citing_paper":{"arxiv_id":"2507.20140","last_updated":"2025-07-27T06:13:58Z","snapshot_observed_at":"2026-08-08T00:44:57.011547Z","submitted_at":"2025-07-27T06:13:58Z","title":"Do Not Mimic My Voice: Speaker Identity Unlearning for Zero-Shot Text-to-Speech","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-06T13:47:42.125593Z"},"links":{"citing_paper":"/paper/2507.20140"},"observation_digest":"sha256:7e2db93c47b59378ee85bb4683484fda6928ae1c9d30d68c91373975a09e0e61","observation_id":"3055b33c-5e10-40eb-a43c-eade073635b0","resolution":{"observed_at":"2026-08-06T13:47:47.568271Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T13:47:42.198678Z","title":"Kong, J., Kim, J., and Bae, J","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.20140","last_updated":"2025-07-27T06:13:58Z","snapshot_observed_at":"2026-08-08T00:44:57.011547Z","submitted_at":"2025-07-27T06:13:58Z","title":"Do Not Mimic My Voice: Speaker Identity Unlearning for Zero-Shot Text-to-Speech","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-06T13:47:42.198678Z"},"links":{"citing_paper":"/paper/2507.20140"},"observation_digest":"sha256:3fd90267d097224635d0f394cced2fd9f093ee70519973b81792def2204fa456","observation_id":"f9de93c8-b3cf-44df-bcc3-0546764776fd","resolution":{"observed_at":"2026-08-06T13:47:42.198678Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2402.16835","last_updated":"2024-02-26T18:57:37Z","snapshot_observed_at":"2026-08-08T00:43:51.702314Z","submitted_at":"2024-02-26T18:57:37Z","title":"Eight Methods to Evaluate Robust Unlearning in LLMs","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.16835","snapshot_observed_at":"2026-08-06T13:47:42.330926Z","title":"Eight methods to evaluate robust unlearning in llms","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2507.20140","last_updated":"2025-07-27T06:13:58Z","snapshot_observed_at":"2026-08-08T00:44:57.011547Z","submitted_at":"2025-07-27T06:13:58Z","title":"Do Not Mimic My Voice: Speaker Identity Unlearning for Zero-Shot Text-to-Speech","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-06T13:47:42.330926Z"},"links":{"cited_paper":"/paper/2402.16835","citing_paper":"/paper/2507.20140"},"observation_digest":"sha256:e9936af43be81409dc3480f36a7e214f233ef48ec366f6e6fa6e6fefc02a5cea","observation_id":"32238566-cc39-47bd-868c-dbd8e7220f39","resolution":{"observed_at":"2026-08-06T13:47:42.330926Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T13:47:47.077139Z","title":"C., and Kolter, J","venue":null,"work_id":"8b5df49f-b484-47d3-a018-f8bba9b91ec9","year":2024},"citing_paper":{"arxiv_id":"2507.20140","last_updated":"2025-07-27T06:13:58Z","snapshot_observed_at":"2026-08-08T00:44:57.011547Z","submitted_at":"2025-07-27T06:13:58Z","title":"Do Not Mimic My Voice: Speaker Identity Unlearning for Zero-Shot Text-to-Speech","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-06T13:47:42.411924Z"},"links":{"citing_paper":"/paper/2507.20140"},"observation_digest":"sha256:eae564e44a9d2912013053722af364e2ee0bc18ec3a9c7e29ff88ac7cf3cb8cf","observation_id":"6f6cf54a-a5c2-47be-9249-756c0b8c7423","resolution":{"observed_at":"2026-08-06T13:47:47.224196Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1907.03458","last_updated":"2019-07-08T08:42:42Z","snapshot_observed_at":"2026-07-06T08:05:45.616325Z","submitted_at":"2019-07-08T08:42:42Z","title":"The GDPR & Speech Data: Reflections of Legal and Technology Communities, First Steps towards a Common Understanding","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1907.03458","snapshot_observed_at":"2026-08-06T13:47:42.637957Z","title":"The gdpr & speech data: Re- flections of legal and technology communities, first steps towards a common understanding","venue":null,"work_id":null,"year":1907},"citing_paper":{"arxiv_id":"2507.20140","last_updated":"2025-07-27T06:13:58Z","snapshot_observed_at":"2026-08-08T00:44:57.011547Z","submitted_at":"2025-07-27T06:13:58Z","title":"Do Not Mimic My Voice: Speaker Identity Unlearning for Zero-Shot Text-to-Speech","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-06T13:47:42.637957Z"},"links":{"cited_paper":"/paper/1907.03458","citing_paper":"/paper/2507.20140"},"observation_digest":"sha256:3b0272dbc340e33123cf03fb95445f988e59da67be42ee57475a96950333ae4c","observation_id":"39d41a1d-eef3-4104-8210-3e2ed0bcf430","resolution":{"observed_at":"2026-08-06T13:47:42.637957Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T13:47:46.571794Z","title":"Librispeech: An asr corpus based on public domain au- dio books","venue":null,"work_id":"82ebf87e-d2b4-40e6-8ef8-585efccd4d53","year":2015},"citing_paper":{"arxiv_id":"2507.20140","last_updated":"2025-07-27T06:13:58Z","snapshot_observed_at":"2026-08-08T00:44:57.011547Z","submitted_at":"2025-07-27T06:13:58Z","title":"Do Not Mimic My Voice: Speaker Identity Unlearning for Zero-Shot Text-to-Speech","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-06T13:47:42.868422Z"},"links":{"citing_paper":"/paper/2507.20140"},"observation_digest":"sha256:1fa5a738d1fffb4a7168c49e63c2802aab3c12789b0e783c367f9094853f6b3b","observation_id":"5d6ce624-d95d-44e2-a15a-764183e659ba","resolution":{"observed_at":"2026-08-06T13:47:46.680283Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T13:47:46.306629Z","title":"Regulation (eu) 2016/679 of the european parliament and of the council","venue":null,"work_id":"c599261a-d8c0-4d30-a33c-5777946d92c8","year":2016},"citing_paper":{"arxiv_id":"2507.20140","last_updated":"2025-07-27T06:13:58Z","snapshot_observed_at":"2026-08-08T00:44:57.011547Z","submitted_at":"2025-07-27T06:13:58Z","title":"Do Not Mimic My Voice: Speaker Identity Unlearning for Zero-Shot Text-to-Speech","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-06T13:47:43.061070Z"},"links":{"citing_paper":"/paper/2507.20140"},"observation_digest":"sha256:b3d7c848332ba40c5e16dc1a4eda359578dcc2ca0887b4d8fdcf5b25fc30480b","observation_id":"8cecd3c1-baf4-46c5-9d0f-f4e5220a3c65","resolution":{"observed_at":"2026-08-06T13:47:46.448277Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T13:47:46.090741Z","title":"Unrolling sgd: Understanding factors influencing ma- chine unlearning","venue":null,"work_id":"c5ec3a34-6235-4ea1-8a9c-ebfe0b006118","year":2022},"citing_paper":{"arxiv_id":"2507.20140","last_updated":"2025-07-27T06:13:58Z","snapshot_observed_at":"2026-08-08T00:44:57.011547Z","submitted_at":"2025-07-27T06:13:58Z","title":"Do Not Mimic My Voice: Speaker Identity Unlearning for Zero-Shot Text-to-Speech","version":1},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-06T13:47:43.109971Z"},"links":{"citing_paper":"/paper/2507.20140"},"observation_digest":"sha256:8d2ce2bc4174ad49fc76969ce8c99da11fbe900113d7eeee72a528cde10f1fea","observation_id":"47356c61-a435-4ec1-931b-6c280f7021b2","resolution":{"observed_at":"2026-08-06T13:47:46.179620Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T13:47:45.868139Z","title":null,"venue":null,"work_id":"7b28aa83-3da9-49e6-9d33-4248def08ced","year":2020},"citing_paper":{"arxiv_id":"2507.20140","last_updated":"2025-07-27T06:13:58Z","snapshot_observed_at":"2026-08-08T00:44:57.011547Z","submitted_at":"2025-07-27T06:13:58Z","title":"Do Not Mimic My Voice: Speaker Identity Unlearning for Zero-Shot Text-to-Speech","version":1},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-06T13:47:43.180454Z"},"links":{"citing_paper":"/paper/2507.20140"},"observation_digest":"sha256:9adba5f2c81c98165fcaa9190b73c3641d068ba87efbdcb45ca2fe672c718283","observation_id":"e11715fc-b976-4333-a779-09eaee7b731e","resolution":{"observed_at":"2026-08-06T13:47:45.969897Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T13:47:45.698120Z","title":"The voiceprivacy 2024 challenge evaluation plan","venue":null,"work_id":"95a618d2-4818-435f-8956-b3345162a47d","year":2024},"citing_paper":{"arxiv_id":"2507.20140","last_updated":"2025-07-27T06:13:58Z","snapshot_observed_at":"2026-08-08T00:44:57.011547Z","submitted_at":"2025-07-27T06:13:58Z","title":"Do Not Mimic My Voice: Speaker Identity Unlearning for Zero-Shot Text-to-Speech","version":1},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-06T13:47:43.258377Z"},"links":{"citing_paper":"/paper/2507.20140"},"observation_digest":"sha256:64d0145dc7f2357085f05ffe74c5ede84246a196761a5ac23d9ddc9e16f86b77","observation_id":"eb39564e-9b02-4a83-97b1-e6648b1cf99b","resolution":{"observed_at":"2026-08-06T13:47:45.760368Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T13:47:45.521561Z","title":"Ma- chine unlearning of features and labels","venue":null,"work_id":"1016da36-9383-4e2a-9d43-18ad2c4dc1d9","year":2022},"citing_paper":{"arxiv_id":"2507.20140","last_updated":"2025-07-27T06:13:58Z","snapshot_observed_at":"2026-08-08T00:44:57.011547Z","submitted_at":"2025-07-27T06:13:58Z","title":"Do Not Mimic My Voice: Speaker Identity Unlearning for Zero-Shot Text-to-Speech","version":1},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-06T13:47:43.335721Z"},"links":{"citing_paper":"/paper/2507.20140"},"observation_digest":"sha256:fac8e7d1f7ca1123eb57b264af00c6fd07fedc022b8e74508a35500a955ae14d","observation_id":"90518fba-7004-4b9f-a3c9-9578959d9a1a","resolution":{"observed_at":"2026-08-06T13:47:45.587398Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T13:47:45.330418Z","title":"Forget- me-not: Learning to forget in text-to-image diffusion models","venue":null,"work_id":"585ebb55-8512-4283-bd4d-003ae6f9ec39","year":2024},"citing_paper":{"arxiv_id":"2507.20140","last_updated":"2025-07-27T06:13:58Z","snapshot_observed_at":"2026-08-08T00:44:57.011547Z","submitted_at":"2025-07-27T06:13:58Z","title":"Do Not Mimic My Voice: Speaker Identity Unlearning for Zero-Shot Text-to-Speech","version":1},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-06T13:47:43.408858Z"},"links":{"citing_paper":"/paper/2507.20140"},"observation_digest":"sha256:e4f1240cd76e03e535e15f2d269cbca0dc03cb819d857c7b8ba0a0d9ba2bfd66","observation_id":"6e93f037-9142-413c-a4e8-a48d69b5c274","resolution":{"observed_at":"2026-08-06T13:47:45.407571Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T13:47:45.178284Z","title":null,"venue":null,"work_id":"8ef9f381-e63e-4fd0-8e2a-ea665e5c442c","year":2024},"citing_paper":{"arxiv_id":"2507.20140","last_updated":"2025-07-27T06:13:58Z","snapshot_observed_at":"2026-08-08T00:44:57.011547Z","submitted_at":"2025-07-27T06:13:58Z","title":"Do Not Mimic My Voice: Speaker Identity Unlearning for Zero-Shot Text-to-Speech","version":1},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-08-06T13:47:43.495845Z"},"links":{"citing_paper":"/paper/2507.20140"},"observation_digest":"sha256:d01e76da24d6d1808a9fa06f01fa7691200e15cc4b69f2591cf16e78725d22b8","observation_id":"65624a8c-696e-4794-80fa-cb2fc6bacf4b","resolution":{"observed_at":"2026-08-06T13:47:45.245269Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T13:47:44.960358Z","title":null,"venue":null,"work_id":"12ef487f-4af8-454b-8bf8-6ee352a68033","year":2024},"citing_paper":{"arxiv_id":"2507.20140","last_updated":"2025-07-27T06:13:58Z","snapshot_observed_at":"2026-08-08T00:44:57.011547Z","submitted_at":"2025-07-27T06:13:58Z","title":"Do Not Mimic My Voice: Speaker Identity Unlearning for Zero-Shot Text-to-Speech","version":1},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-08-06T13:47:43.568933Z"},"links":{"citing_paper":"/paper/2507.20140"},"observation_digest":"sha256:04b71b61ec9d13dd5d80e1e16e270e86eba108af78a690f94cf0b383e6e7b2ef","observation_id":"1f71f391-e618-4ce8-b6bb-abbbcce105ff","resolution":{"observed_at":"2026-08-06T13:47:45.062315Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T13:47:44.604882Z","title":"From LibriSpeech test-clean dataset samples of durations 4 to 10 seconds, we construct noise at a -10dB signal-to-noise ratio over half of each sample’s duration","venue":null,"work_id":"040a2477-d62a-4cde-afe1-e1d1147a6d1d","year":2024},"citing_paper":{"arxiv_id":"2507.20140","last_updated":"2025-07-27T06:13:58Z","snapshot_observed_at":"2026-08-08T00:44:57.011547Z","submitted_at":"2025-07-27T06:13:58Z","title":"Do Not Mimic My Voice: Speaker Identity Unlearning for Zero-Shot Text-to-Speech","version":1},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-08-06T13:47:43.706546Z"},"links":{"citing_paper":"/paper/2507.20140"},"observation_digest":"sha256:145900cc1682f71ef80c09488a132cef482b4dca157666ef41d4149a2305ff55","observation_id":"71ca581e-8769-4c08-81e1-f2b46c217bf9","resolution":{"observed_at":"2026-08-06T13:47:44.681590Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T13:47:44.401434Z","title":"WER and SIM evaluation follows the procedures of Table1","venue":null,"work_id":"c0d1f20a-b484-4703-a210-7905aeffcb75","year":2019},"citing_paper":{"arxiv_id":"2507.20140","last_updated":"2025-07-27T06:13:58Z","snapshot_observed_at":"2026-08-08T00:44:57.011547Z","submitted_at":"2025-07-27T06:13:58Z","title":"Do Not Mimic My Voice: Speaker Identity Unlearning for Zero-Shot Text-to-Speech","version":1},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-08-06T13:47:43.772071Z"},"links":{"citing_paper":"/paper/2507.20140"},"observation_digest":"sha256:fd6a4a3fb6505af4601333c0cdbdfa7fa2912ce53785b5226e0b3634abe25d13","observation_id":"b9b10ca2-40d8-4a35-81ca-57f60e4c258b","resolution":{"observed_at":"2026-08-06T13:47:44.519820Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T13:47:42.259727Z","title":"doi: 10.1109/18.61115","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2507.20140","last_updated":"2025-07-27T06:13:58Z","snapshot_observed_at":"2026-08-08T00:44:57.011547Z","submitted_at":"2025-07-27T06:13:58Z","title":"Do Not Mimic My Voice: Speaker Identity Unlearning for Zero-Shot Text-to-Speech","version":1},"reference_index":2006,"source":"pdf_text","source_observed_at":"2026-08-06T13:47:42.259727Z"},"links":{"citing_paper":"/paper/2507.20140"},"observation_digest":"sha256:935bf2583392e307c3d2ab8d9471a9cac510e25fd72d8643509cc469f8b73d5d","observation_id":"40f3456b-9473-4aef-9889-d21bed54cb8a","resolution":{"observed_at":"2026-08-06T13:47:42.259727Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T13:47:46.780308Z","title":"Montreal forced aligner: Trainable text- speech alignment using kaldi","venue":null,"work_id":"94638309-1ba8-4abf-8ba8-6dbb56cf9a68","year":2017},"citing_paper":{"arxiv_id":"2507.20140","last_updated":"2025-07-27T06:13:58Z","snapshot_observed_at":"2026-08-08T00:44:57.011547Z","submitted_at":"2025-07-27T06:13:58Z","title":"Do Not Mimic My Voice: Speaker Identity Unlearning for Zero-Shot Text-to-Speech","version":1},"reference_index":2013,"source":"pdf_text","source_observed_at":"2026-08-06T13:47:42.485745Z"},"links":{"citing_paper":"/paper/2507.20140"},"observation_digest":"sha256:c438b232ae2b5cfeddbafd28eb00d9dcca284322a5096f8fdba930d7cba59c32","observation_id":"1a510928-e14f-4ac9-b5e8-203f78517346","resolution":{"observed_at":"2026-08-06T13:47:46.945251Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T13:47:42.958499Z","title":"Press, O., Smith, N","venue":null,"work_id":null,"year":2015},"citing_paper":{"arxiv_id":"2507.20140","last_updated":"2025-07-27T06:13:58Z","snapshot_observed_at":"2026-08-08T00:44:57.011547Z","submitted_at":"2025-07-27T06:13:58Z","title":"Do Not Mimic My Voice: Speaker Identity Unlearning for Zero-Shot Text-to-Speech","version":1},"reference_index":2015,"source":"pdf_text","source_observed_at":"2026-08-06T13:47:42.958499Z"},"links":{"citing_paper":"/paper/2507.20140"},"observation_digest":"sha256:3f9b2895e6011b42789a5ac30d9d72cc7f97022c2c0c52331294dae387d2dd9d","observation_id":"be97f314-a3e2-48fc-8aa9-2b714995b873","resolution":{"observed_at":"2026-08-06T13:47:42.958499Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T13:47:42.559914Z","title":"the right to be forgotten","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2507.20140","last_updated":"2025-07-27T06:13:58Z","snapshot_observed_at":"2026-08-08T00:44:57.011547Z","submitted_at":"2025-07-27T06:13:58Z","title":"Do Not Mimic My Voice: Speaker Identity Unlearning for Zero-Shot Text-to-Speech","version":1},"reference_index":2017,"source":"pdf_text","source_observed_at":"2026-08-06T13:47:42.559914Z"},"links":{"citing_paper":"/paper/2507.20140"},"observation_digest":"sha256:7132a9d3581cfc2223e1879e8ddb6c97c7753280540dbdc5a772ed90484802b3","observation_id":"c3fc0525-ac3f-421b-9367-4bf3b7ce8265","resolution":{"observed_at":"2026-08-06T13:47:42.559914Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T13:47:41.873389Z","title":"Wavlm: Large-scale self-supervised pre- training for full stack speech processing","venue":null,"work_id":null,"year":1941},"citing_paper":{"arxiv_id":"2507.20140","last_updated":"2025-07-27T06:13:58Z","snapshot_observed_at":"2026-08-08T00:44:57.011547Z","submitted_at":"2025-07-27T06:13:58Z","title":"Do Not Mimic My Voice: Speaker Identity Unlearning for Zero-Shot Text-to-Speech","version":1},"reference_index":2018,"source":"pdf_text","source_observed_at":"2026-08-06T13:47:41.873389Z"},"links":{"citing_paper":"/paper/2507.20140"},"observation_digest":"sha256:8b780202dc1864c75043fd649534a76028c34811860a4d577a956381dd3367bf","observation_id":"8b57ef5a-c87f-4198-a65a-6338ec5c8d39","resolution":{"observed_at":"2026-08-06T13:47:41.873389Z","resolver_source":null,"status":"malformed_identifier"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T13:47:47.766351Z","title":"A., Jia, H., Travers, A., Zhang, B., Lie, D., and Papernot, 9 Do Not Mimic My Voice: Speaker Identity Unlearning for Zero-Shot Text-to-Speech N","venue":null,"work_id":"583a02e3-381f-410d-b2ac-97b226116936","year":2021},"citing_paper":{"arxiv_id":"2507.20140","last_updated":"2025-07-27T06:13:58Z","snapshot_observed_at":"2026-08-08T00:44:57.011547Z","submitted_at":"2025-07-27T06:13:58Z","title":"Do Not Mimic My Voice: Speaker Identity Unlearning for Zero-Shot Text-to-Speech","version":1},"reference_index":2019,"source":"pdf_text","source_observed_at":"2026-08-06T13:47:41.730513Z"},"links":{"citing_paper":"/paper/2507.20140"},"observation_digest":"sha256:bc01a4728c0c38b97c2dad085a7ac2a099888f74a589a7ff3a3b1ecdd1aa3939","observation_id":"2fd62a0b-f382-4f33-acff-fc86a14397b6","resolution":{"observed_at":"2026-08-06T13:47:47.879513Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T13:47:47.953544Z","title":"Five years of the right to be forgotten","venue":null,"work_id":"10f4e063-c2b9-4713-a8dc-d84531d88985","year":2019},"citing_paper":{"arxiv_id":"2507.20140","last_updated":"2025-07-27T06:13:58Z","snapshot_observed_at":"2026-08-08T00:44:57.011547Z","submitted_at":"2025-07-27T06:13:58Z","title":"Do Not Mimic My Voice: Speaker Identity Unlearning for Zero-Shot Text-to-Speech","version":1},"reference_index":2022,"source":"pdf_text","source_observed_at":"2026-08-06T13:47:41.643940Z"},"links":{"citing_paper":"/paper/2507.20140"},"observation_digest":"sha256:28e3759f1d140eae7f37a41f9371a6fbe0f2f582c839250a9d024c41c1d5290b","observation_id":"1a753c89-6590-40f2-a33a-8c9559047c57","resolution":{"observed_at":"2026-08-06T13:47:48.016885Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T13:47:47.627634Z","title":"Graph unlearning","venue":null,"work_id":"0009c80a-68ec-4276-95b4-fc4e37c987f6","year":2022},"citing_paper":{"arxiv_id":"2507.20140","last_updated":"2025-07-27T06:13:58Z","snapshot_observed_at":"2026-08-08T00:44:57.011547Z","submitted_at":"2025-07-27T06:13:58Z","title":"Do Not Mimic My Voice: Speaker Identity Unlearning for Zero-Shot Text-to-Speech","version":1},"reference_index":2023,"source":"pdf_text","source_observed_at":"2026-08-06T13:47:41.793216Z"},"links":{"citing_paper":"/paper/2507.20140"},"observation_digest":"sha256:78e22051829d0a0097920574606bc07c25b8cc9ff00cc4a25997ec86f916cfba","observation_id":"f297f6d6-6001-474b-a855-f9323938f005","resolution":{"observed_at":"2026-08-06T13:47:47.735720Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2207.12598","last_updated":"2022-07-26T01:42:07Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2022-07-26T01:42:07Z","title":"Classifier-Free Diffusion Guidance","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2207.12598","snapshot_observed_at":"2026-08-06T13:47:41.998231Z","title":"and Salimans, T","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2507.20140","last_updated":"2025-07-27T06:13:58Z","snapshot_observed_at":"2026-08-08T00:44:57.011547Z","submitted_at":"2025-07-27T06:13:58Z","title":"Do Not Mimic My Voice: Speaker Identity Unlearning for Zero-Shot Text-to-Speech","version":1},"reference_index":2024,"source":"pdf_text","source_observed_at":"2026-08-06T13:47:41.998231Z"},"links":{"cited_paper":"/paper/2207.12598","citing_paper":"/paper/2507.20140"},"observation_digest":"sha256:b7cb29bdf4074611aca827b01fd0c66bb99aba50a4aca924239078c322b72d41","observation_id":"c8a2759a-603d-4b9a-a3db-49445ae2a5aa","resolution":{"observed_at":"2026-08-06T13:47:41.998231Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T13:47:42.742031Z","title":"doi: 10.1145/3749987","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2507.20140","last_updated":"2025-07-27T06:13:58Z","snapshot_observed_at":"2026-08-08T00:44:57.011547Z","submitted_at":"2025-07-27T06:13:58Z","title":"Do Not Mimic My Voice: Speaker Identity Unlearning for Zero-Shot Text-to-Speech","version":1},"reference_index":2025,"source":"pdf_text","source_observed_at":"2026-08-06T13:47:42.742031Z"},"links":{"citing_paper":"/paper/2507.20140"},"observation_digest":"sha256:d9944628390335516930c74196488d7b505391336ce958ec2ac2e781b9e33d5e","observation_id":"fcc5f29b-33e2-497e-a584-63df39c48703","resolution":{"observed_at":"2026-08-06T13:47:42.742031Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"paper":{"arxiv_id":"2507.20140","last_updated":"2025-07-27T06:13:58Z","latest_version":1,"primary_category":"cs.SD","snapshot_observed_at":"2026-08-08T00:44:57.011547Z","submitted_at":"2025-07-27T06:13:58Z","title":"Do Not Mimic My Voice: Speaker Identity Unlearning for Zero-Shot Text-to-Speech"},"reference_resolution":{"displayed":29,"state_counts":{"malformed_identifier":1,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":14,"verified_exact":0,"verified_fuzzy":14},"total_outbound_references":29},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"thesis":"As of 9 August 2026, this Paper Citation Record lists 29 of 29 outbound references and 0 inbound Pith citation observations for arXiv:2507.20140."}