{"as_of":"2026-08-13T09:55:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:21c72c901783263007281542f5bf681d8dcf0f29e44e99eb8df001ed666d7a86","coverage":[{"denominator":39,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":39,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-07T15:30:36.600275Z","state":"measured"},{"denominator":41,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":41,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-13T06:32:02.005865+00:00","state":"measured"},{"denominator":2,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":2,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-07T15:30:33.930912Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":1,"source":"arxiv_reference","source_observed_at":"2026-08-05T02:28:24.338817Z","state":"measured"}],"external_citation_measurements":[{"count":0,"observed_at":"2026-08-05T02:28:24.338817Z","source":"arxiv_reference"}],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2505.15004","last_updated":"2025-05-30T08:08:47Z","snapshot_observed_at":"2026-08-10T17:50:19.872730Z","submitted_at":"2025-05-21T01:17:09Z","title":"EASY: Emotion-aware Speaker Anonymization via Factorized Distillation","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2505.15004","snapshot_observed_at":"2026-08-07T15:30:33.930912Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.15004","last_updated":"2025-05-30T08:08:47Z","snapshot_observed_at":"2026-08-10T17:50:19.872730Z","submitted_at":"2025-05-21T01:17:09Z","title":"EASY: Emotion-aware Speaker Anonymization via Factorized Distillation","version":2},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-07T15:30:33.930912Z"},"links":{"cited_paper":"/paper/2505.15004","citing_paper":"/paper/2505.15004"},"observation_digest":"sha256:c02e8f306d7581bf7877e7e93a006adb6dc025445e5a561a6c76642b55378aa4","observation_id":"198e4187-60d1-40ae-909a-e47c601fccc9","resolution":{"observed_at":"2026-08-07T15:30:33.930912Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2505.15004","last_updated":"2025-05-30T08:08:47Z","snapshot_observed_at":"2026-08-10T17:50:19.872730Z","submitted_at":"2025-05-21T01:17:09Z","title":"EASY: Emotion-aware Speaker Anonymization via Factorized Distillation","version":2},"cited_work":{"arxiv_id":"2505.15004","doi":"10.48550/arxiv.2505.15004","metadata_source":"arxiv_reference","pith_arxiv_id":"2505.15004","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"doi:10.48550/arXiv.2505.15004 , abstract =","venue":"ArXiv.org","work_id":"c4b24c83-5317-48d5-8231-0bb3c3c0e885","year":null},"citing_paper":{"arxiv_id":"2606.00407","last_updated":"2026-05-29T22:49:56Z","snapshot_observed_at":"2026-08-04T15:20:49.286788Z","submitted_at":"2026-05-29T22:49:56Z","title":"Privacy-preserving Prosody Representation Learning","version":1},"reference_index":63,"source":"arxiv_source","source_observed_at":"2026-06-28T20:32:36.085961Z"},"links":{"cited_paper":"/paper/2505.15004","citing_paper":"/paper/2606.00407"},"observation_digest":"sha256:89d355374ce1003ed30b8ea26bcbdf162515b51f72fc784771feef478c823193","observation_id":"66f1d654-5490-4031-a209-8dfe8f04af9a","resolution":{"observed_at":"2026-06-28T20:42:37.027025Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}}],"links":{"evidence":"/evidence","html":"/paper/2505.15004/citation-record","integrity":"/paper/2505.15004/integrity","json":"/paper/2505.15004/citation-record.json","paper":"/paper/2505.15004"},"outbound":[{"citation":{"cited_paper":{"arxiv_id":"2505.15004","last_updated":"2025-05-30T08:08:47Z","snapshot_observed_at":"2026-08-10T17:50:19.872730Z","submitted_at":"2025-05-21T01:17:09Z","title":"EASY: Emotion-aware Speaker Anonymization via Factorized Distillation","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2505.15004","snapshot_observed_at":"2026-08-07T15:30:33.930912Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.15004","last_updated":"2025-05-30T08:08:47Z","snapshot_observed_at":"2026-08-10T17:50:19.872730Z","submitted_at":"2025-05-21T01:17:09Z","title":"EASY: Emotion-aware Speaker Anonymization via Factorized Distillation","version":2},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-07T15:30:33.930912Z"},"links":{"cited_paper":"/paper/2505.15004","citing_paper":"/paper/2505.15004"},"observation_digest":"sha256:c02e8f306d7581bf7877e7e93a006adb6dc025445e5a561a6c76642b55378aa4","observation_id":"198e4187-60d1-40ae-909a-e47c601fccc9","resolution":{"observed_at":"2026-08-07T15:30:33.930912Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:30:37.035445Z","title":null,"venue":null,"work_id":"a733f754-0665-4a0f-b762-3fdad09685c8","year":null},"citing_paper":{"arxiv_id":"2505.15004","last_updated":"2025-05-30T08:08:47Z","snapshot_observed_at":"2026-08-10T17:50:19.872730Z","submitted_at":"2025-05-21T01:17:09Z","title":"EASY: Emotion-aware Speaker Anonymization via Factorized Distillation","version":2},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-07T15:30:33.970569Z"},"links":{"citing_paper":"/paper/2505.15004"},"observation_digest":"sha256:c94aed794d184c0b7e6bc4fac5e2b65ddf8d96257876dab2655c142205d4a4e5","observation_id":"c4b4d3a8-cc93-48e3-82ca-ec9b269ac95b","resolution":{"observed_at":"2026-08-07T15:30:37.038410Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:30:37.024821Z","title":"Dataset We train EASY using the training portions of both the Lib- riSpeech [28] and LibriTTS [29] corpora","venue":null,"work_id":"2f3dd8c1-f303-4f9b-8fd1-858cde10452e","year":2024},"citing_paper":{"arxiv_id":"2505.15004","last_updated":"2025-05-30T08:08:47Z","snapshot_observed_at":"2026-08-10T17:50:19.872730Z","submitted_at":"2025-05-21T01:17:09Z","title":"EASY: Emotion-aware Speaker Anonymization via Factorized Distillation","version":2},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-07T15:30:34.072220Z"},"links":{"citing_paper":"/paper/2505.15004"},"observation_digest":"sha256:044a718a46863fae9c98694fdf133c950f64cbd7fbad99f1bb76b1cd20ef396e","observation_id":"970dbd83-bc31-49fc-8382-fffd9df50f81","resolution":{"observed_at":"2026-08-07T15:30:37.028658Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:30:37.013219Z","title":null,"venue":null,"work_id":"f8ab08b8-e326-481e-9dab-74dc84497849","year":null},"citing_paper":{"arxiv_id":"2505.15004","last_updated":"2025-05-30T08:08:47Z","snapshot_observed_at":"2026-08-10T17:50:19.872730Z","submitted_at":"2025-05-21T01:17:09Z","title":"EASY: Emotion-aware Speaker Anonymization via Factorized Distillation","version":2},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-07T15:30:34.140325Z"},"links":{"citing_paper":"/paper/2505.15004"},"observation_digest":"sha256:4e5174bb707e03715295bb5ae8490f44a6c684bedd1bec9a65023ead9f1c4e0e","observation_id":"874e0e59-c6ca-4602-95d0-4acc4c7f64e3","resolution":{"observed_at":"2026-08-07T15:30:37.016844Z","resolver_source":"raw_fallback","status":"malformed_identifier"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:30:37.002833Z","title":"Speaker identity is first disentangled using a supervised classifier, producing a speaker-independent representation","venue":null,"work_id":"5d12e90e-44dd-4059-9d88-4e78860d97e8","year":2024},"citing_paper":{"arxiv_id":"2505.15004","last_updated":"2025-05-30T08:08:47Z","snapshot_observed_at":"2026-08-10T17:50:19.872730Z","submitted_at":"2025-05-21T01:17:09Z","title":"EASY: Emotion-aware Speaker Anonymization via Factorized Distillation","version":2},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-07T15:30:34.315191Z"},"links":{"citing_paper":"/paper/2505.15004"},"observation_digest":"sha256:f04238817978096b7405275b54dbc68f2111072f650760fa4ae80e852931b73e","observation_id":"53901543-c9d8-41f4-b434-e7b55d07a359","resolution":{"observed_at":"2026-08-07T15:30:37.006358Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:30:36.992196Z","title":null,"venue":null,"work_id":"27d1bba8-9907-4d2c-af3e-1f3f164bce15","year":null},"citing_paper":{"arxiv_id":"2505.15004","last_updated":"2025-05-30T08:08:47Z","snapshot_observed_at":"2026-08-10T17:50:19.872730Z","submitted_at":"2025-05-21T01:17:09Z","title":"EASY: Emotion-aware Speaker Anonymization via Factorized Distillation","version":2},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-07T15:30:34.497940Z"},"links":{"citing_paper":"/paper/2505.15004"},"observation_digest":"sha256:8a545cbc82c0e3bbb3ee90457b731b7f690cffd27147a17d8df36d0698d93115","observation_id":"96e2530a-9857-4d2f-97a5-9a2746081b89","resolution":{"observed_at":"2026-08-07T15:30:36.995560Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:30:36.981100Z","title":null,"venue":null,"work_id":"dd39cac5-10c5-4db6-a995-cff206523a57","year":2024},"citing_paper":{"arxiv_id":"2505.15004","last_updated":"2025-05-30T08:08:47Z","snapshot_observed_at":"2026-08-10T17:50:19.872730Z","submitted_at":"2025-05-21T01:17:09Z","title":"EASY: Emotion-aware Speaker Anonymization via Factorized Distillation","version":2},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-07T15:30:34.639183Z"},"links":{"citing_paper":"/paper/2505.15004"},"observation_digest":"sha256:e783092941e5294453cb12193ffcaec9570e53569a04511ce67c4653b2f4d60c","observation_id":"ee9b3edb-3147-4912-ad71-262c7aebca6b","resolution":{"observed_at":"2026-08-07T15:30:36.984332Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2410.00037","last_updated":"2024-10-02T09:11:45Z","snapshot_observed_at":"2026-07-30T10:21:14.474746Z","submitted_at":"2024-09-17T17:55:39Z","title":"Moshi: a speech-text foundation model for real-time dialogue","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2410.00037","snapshot_observed_at":"2026-08-07T15:30:34.761517Z","title":"Moshi: a speech-text foundation model for real-time dialogue,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.15004","last_updated":"2025-05-30T08:08:47Z","snapshot_observed_at":"2026-08-10T17:50:19.872730Z","submitted_at":"2025-05-21T01:17:09Z","title":"EASY: Emotion-aware Speaker Anonymization via Factorized Distillation","version":2},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-07T15:30:34.761517Z"},"links":{"cited_paper":"/paper/2410.00037","citing_paper":"/paper/2505.15004"},"observation_digest":"sha256:91ead075d01908724dbaed3f4a206b7c09aec473938301112aca6bfebe199bf7","observation_id":"2c6be2a3-d5e2-4a77-a880-eda5ccc1eb85","resolution":{"observed_at":"2026-08-07T15:30:34.761517Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2408.16725","last_updated":"2024-11-05T02:24:18Z","snapshot_observed_at":"2026-08-12T22:55:00.524050Z","submitted_at":"2024-08-29T17:18:53Z","title":"Mini-Omni: Language Models Can Hear, Talk While Thinking in Streaming","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2408.16725","snapshot_observed_at":"2026-08-07T15:30:34.872228Z","title":"Mini-omni: Language models can hear, talk while thinking in streaming,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.15004","last_updated":"2025-05-30T08:08:47Z","snapshot_observed_at":"2026-08-10T17:50:19.872730Z","submitted_at":"2025-05-21T01:17:09Z","title":"EASY: Emotion-aware Speaker Anonymization via Factorized Distillation","version":2},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-07T15:30:34.872228Z"},"links":{"cited_paper":"/paper/2408.16725","citing_paper":"/paper/2505.15004"},"observation_digest":"sha256:d733c4c3131d4582ee3fdfb5334ac046d826af1ed6d9264fa5ebecc748e67c10","observation_id":"30413a33-0c12-489e-aee1-2006289fca67","resolution":{"observed_at":"2026-08-07T15:30:34.872228Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2408.05928","last_updated":"2025-04-23T00:44:18Z","snapshot_observed_at":"2026-08-12T23:05:12.865589Z","submitted_at":"2024-08-12T05:40:21Z","title":"Adapting General Disentanglement-Based Speaker Anonymization for Enhanced Emotion Preservation","version":2},"cited_work":{"arxiv_id":"2408.05928","doi":null,"metadata_source":"pith","pith_arxiv_id":"2408.05928","snapshot_observed_at":"2026-08-07T15:30:36.753539Z","title":"Adapting General Disentanglement-Based Speaker Anonymization for Enhanced Emotion Preservation","venue":"cs.SD","work_id":"e8c565be-96b2-412e-bbfc-20a1a13893a0","year":2024},"citing_paper":{"arxiv_id":"2505.15004","last_updated":"2025-05-30T08:08:47Z","snapshot_observed_at":"2026-08-10T17:50:19.872730Z","submitted_at":"2025-05-21T01:17:09Z","title":"EASY: Emotion-aware Speaker Anonymization via Factorized Distillation","version":2},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-07T15:30:34.993617Z"},"links":{"cited_paper":"/paper/2408.05928","citing_paper":"/paper/2505.15004"},"observation_digest":"sha256:8dcde914f0b02d3638d726dd0dc5a10c34a39cc4c2954be55ccf214478b2f211","observation_id":"4f8e7d93-e3ec-4553-9f37-a35982475fb3","resolution":{"observed_at":"2026-08-07T15:30:36.757607Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:30:36.970742Z","title":"The voiceprivacy 2020 challenge: Results and findings,","venue":null,"work_id":"f3a35746-04ef-479b-83b1-339c7fab22a0","year":2020},"citing_paper":{"arxiv_id":"2505.15004","last_updated":"2025-05-30T08:08:47Z","snapshot_observed_at":"2026-08-10T17:50:19.872730Z","submitted_at":"2025-05-21T01:17:09Z","title":"EASY: Emotion-aware Speaker Anonymization via Factorized Distillation","version":2},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-07T15:30:35.054353Z"},"links":{"citing_paper":"/paper/2505.15004"},"observation_digest":"sha256:7a18749c04e5ff71ada07769fa7d60858913ed3d6dab41372cd7a0ea1371c105","observation_id":"420119ee-e7bb-4689-b2db-1c10dbc7721d","resolution":{"observed_at":"2026-08-07T15:30:36.974239Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:30:36.960218Z","title":"The voiceprivacy 2022 challenge: Progress and perspec- tives in voice anonymisation,","venue":null,"work_id":"b9fe68d7-4cf2-40f6-806e-7f98f2edf587","year":2022},"citing_paper":{"arxiv_id":"2505.15004","last_updated":"2025-05-30T08:08:47Z","snapshot_observed_at":"2026-08-10T17:50:19.872730Z","submitted_at":"2025-05-21T01:17:09Z","title":"EASY: Emotion-aware Speaker Anonymization via Factorized Distillation","version":2},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-07T15:30:35.058080Z"},"links":{"citing_paper":"/paper/2505.15004"},"observation_digest":"sha256:0a1831a07fdfb16950436000f316b9bd12baa95b787a537261a47e513051210f","observation_id":"d4856ac8-a685-4b28-bbf7-77558d383de7","resolution":{"observed_at":"2026-08-07T15:30:36.963920Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2404.02677","last_updated":"2024-06-12T14:05:43Z","snapshot_observed_at":"2026-08-13T00:38:31.924419Z","submitted_at":"2024-04-03T12:20:51Z","title":"The VoicePrivacy 2024 Challenge Evaluation Plan","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2404.02677","snapshot_observed_at":"2026-08-07T15:30:35.135306Z","title":"The voiceprivacy 2024 challenge evaluation plan,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.15004","last_updated":"2025-05-30T08:08:47Z","snapshot_observed_at":"2026-08-10T17:50:19.872730Z","submitted_at":"2025-05-21T01:17:09Z","title":"EASY: Emotion-aware Speaker Anonymization via Factorized Distillation","version":2},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-07T15:30:35.135306Z"},"links":{"cited_paper":"/paper/2404.02677","citing_paper":"/paper/2505.15004"},"observation_digest":"sha256:84f62df7781a48bfaf0c362beb97bd56c3ffc6cadf0e6ecf7a8d5e928b828932","observation_id":"fdfaab5b-a642-4136-953a-348acff1100d","resolution":{"observed_at":"2026-08-07T15:30:35.135306Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:30:36.949150Z","title":"Speaker anonymisation using the mcadams co- efficient,","venue":null,"work_id":"5246e879-59df-46cf-8ab2-ba60e8bb6477","year":2021},"citing_paper":{"arxiv_id":"2505.15004","last_updated":"2025-05-30T08:08:47Z","snapshot_observed_at":"2026-08-10T17:50:19.872730Z","submitted_at":"2025-05-21T01:17:09Z","title":"EASY: Emotion-aware Speaker Anonymization via Factorized Distillation","version":2},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-07T15:30:35.206394Z"},"links":{"citing_paper":"/paper/2505.15004"},"observation_digest":"sha256:96d3c259e318306dc7608332ae5f6fadea38da01355b04ad3a4fb2762ec7ef3f","observation_id":"253d0efc-150c-4113-bcfe-5c663207518f","resolution":{"observed_at":"2026-08-07T15:30:36.953226Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:30:35.265049Z","title":"Improving speaker de-identification with functional data analysis of f0 trajectories,","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2505.15004","last_updated":"2025-05-30T08:08:47Z","snapshot_observed_at":"2026-08-10T17:50:19.872730Z","submitted_at":"2025-05-21T01:17:09Z","title":"EASY: Emotion-aware Speaker Anonymization via Factorized Distillation","version":2},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-07T15:30:35.265049Z"},"links":{"citing_paper":"/paper/2505.15004"},"observation_digest":"sha256:6a417de5f20b6a038ae54e63101b5b317e0d9ab9343ca1a386ba03c15b86289a","observation_id":"87a6899c-0e43-449c-94a4-be0bb4670658","resolution":{"observed_at":"2026-08-07T15:30:35.265049Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:30:36.932825Z","title":"Speaker anonymiza- tion by pitch shifting based on time-scale modification,","venue":null,"work_id":"07d1b648-460c-4e04-9713-4a3b3cb6e767","year":2022},"citing_paper":{"arxiv_id":"2505.15004","last_updated":"2025-05-30T08:08:47Z","snapshot_observed_at":"2026-08-10T17:50:19.872730Z","submitted_at":"2025-05-21T01:17:09Z","title":"EASY: Emotion-aware Speaker Anonymization via Factorized Distillation","version":2},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-07T15:30:35.319225Z"},"links":{"citing_paper":"/paper/2505.15004"},"observation_digest":"sha256:a32bad6ea201d43492a0d58308c54440fe07f5254263aecb62d879185d15e03b","observation_id":"e846ce8b-9eab-4c13-8aa5-9f3e0bca68f4","resolution":{"observed_at":"2026-08-07T15:30:36.935949Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:30:36.922017Z","title":"Privacy and utility of x-vector based speaker anonymiza- tion,","venue":null,"work_id":"4fc484ba-ed24-461c-859f-d08df0b4ce0d","year":2022},"citing_paper":{"arxiv_id":"2505.15004","last_updated":"2025-05-30T08:08:47Z","snapshot_observed_at":"2026-08-10T17:50:19.872730Z","submitted_at":"2025-05-21T01:17:09Z","title":"EASY: Emotion-aware Speaker Anonymization via Factorized Distillation","version":2},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-07T15:30:35.381806Z"},"links":{"citing_paper":"/paper/2505.15004"},"observation_digest":"sha256:88a0ab6b74117f2af6a606788b5426e5c6efd7b90e0cb3ea78f67b8b1554b21c","observation_id":"a5474b93-e62c-46d4-ad54-6957a291fd48","resolution":{"observed_at":"2026-08-07T15:30:36.926325Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2305.18823","last_updated":"2023-09-13T01:21:34Z","snapshot_observed_at":"2026-08-10T20:54:04.879631Z","submitted_at":"2023-05-30T08:16:10Z","title":"Speaker anonymization using orthogonal Householder neural network","version":2},"cited_work":{"arxiv_id":"2305.18823","doi":null,"metadata_source":"pith","pith_arxiv_id":"2305.18823","snapshot_observed_at":"2026-08-07T15:30:36.727479Z","title":"Speaker anonymization using orthogonal Householder neural network","venue":"cs.SD","work_id":"40acd0b1-19bd-4acb-9958-2fd505ad2187","year":2023},"citing_paper":{"arxiv_id":"2505.15004","last_updated":"2025-05-30T08:08:47Z","snapshot_observed_at":"2026-08-10T17:50:19.872730Z","submitted_at":"2025-05-21T01:17:09Z","title":"EASY: Emotion-aware Speaker Anonymization via Factorized Distillation","version":2},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-07T15:30:35.444294Z"},"links":{"cited_paper":"/paper/2305.18823","citing_paper":"/paper/2505.15004"},"observation_digest":"sha256:255ed5700742faee9eebbc3b853a923d21a265ae3bc74e36b19404a1e01e8610","observation_id":"47de9b19-db89-43dd-bc52-cc27d3f2127f","resolution":{"observed_at":"2026-08-07T15:30:36.731285Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:30:36.910815Z","title":"Dis- tinguishable speaker anonymization based on formant and fun- damental frequency scaling,","venue":null,"work_id":"49bcf749-a9b2-4d11-a2d5-ccbad907d002","year":2023},"citing_paper":{"arxiv_id":"2505.15004","last_updated":"2025-05-30T08:08:47Z","snapshot_observed_at":"2026-08-10T17:50:19.872730Z","submitted_at":"2025-05-21T01:17:09Z","title":"EASY: Emotion-aware Speaker Anonymization via Factorized Distillation","version":2},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-07T15:30:35.516656Z"},"links":{"citing_paper":"/paper/2505.15004"},"observation_digest":"sha256:eaf47d3ffc708eb0e2dfb207bae68e6f650c8e28712ef384c655453c4383d6e1","observation_id":"a70635d3-d9a2-4f20-83f6-dbbfdea6964e","resolution":{"observed_at":"2026-08-07T15:30:36.914745Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:30:36.900426Z","title":"Prosody is not identity: A speaker anonymization approach using prosody cloning,","venue":null,"work_id":"f96bdc54-b4c0-4543-bcf4-925fba8798cc","year":2023},"citing_paper":{"arxiv_id":"2505.15004","last_updated":"2025-05-30T08:08:47Z","snapshot_observed_at":"2026-08-10T17:50:19.872730Z","submitted_at":"2025-05-21T01:17:09Z","title":"EASY: Emotion-aware Speaker Anonymization via Factorized Distillation","version":2},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-07T15:30:35.555826Z"},"links":{"citing_paper":"/paper/2505.15004"},"observation_digest":"sha256:733ce6361738ccf4bd014da0ececafedb203292394b7edce033d4cce3b47380b","observation_id":"e654ac20-bf51-4086-bae9-c4e64a453260","resolution":{"observed_at":"2026-08-07T15:30:36.903851Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:30:36.889837Z","title":"Distinctive and natural speaker anonymization via singular value transformation- assisted matrix,","venue":null,"work_id":"0e7d4c1b-05dd-47da-9565-d5b2f776049f","year":2024},"citing_paper":{"arxiv_id":"2505.15004","last_updated":"2025-05-30T08:08:47Z","snapshot_observed_at":"2026-08-10T17:50:19.872730Z","submitted_at":"2025-05-21T01:17:09Z","title":"EASY: Emotion-aware Speaker Anonymization via Factorized Distillation","version":2},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-07T15:30:35.639921Z"},"links":{"citing_paper":"/paper/2505.15004"},"observation_digest":"sha256:f652f936c6f1d05b923469704be10db1ff059cc243149f037e3086883e9ecbd9","observation_id":"192a6bfd-f099-4980-a6d1-2a9d47d64857","resolution":{"observed_at":"2026-08-07T15:30:36.893073Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:30:36.879901Z","title":"Speaker anonymization using neural audio codec language models,","venue":null,"work_id":"31129f67-6351-4c43-a4ac-f45b3dec0c9d","year":2024},"citing_paper":{"arxiv_id":"2505.15004","last_updated":"2025-05-30T08:08:47Z","snapshot_observed_at":"2026-08-10T17:50:19.872730Z","submitted_at":"2025-05-21T01:17:09Z","title":"EASY: Emotion-aware Speaker Anonymization via Factorized Distillation","version":2},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-07T15:30:35.740288Z"},"links":{"citing_paper":"/paper/2505.15004"},"observation_digest":"sha256:11e62c2217771c1101103d028be8a43f893674dcab709c3765921a0ec06b2d5f","observation_id":"fa6c6e0d-30bf-408a-9f75-aa345bb68551","resolution":{"observed_at":"2026-08-07T15:30:36.883456Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:30:36.869037Z","title":"MUSA: Multi-lingual speaker anonymization via serial disen- tanglement,","venue":null,"work_id":"38755116-985d-45f2-88dc-91a5593b7b6a","year":2025},"citing_paper":{"arxiv_id":"2505.15004","last_updated":"2025-05-30T08:08:47Z","snapshot_observed_at":"2026-08-10T17:50:19.872730Z","submitted_at":"2025-05-21T01:17:09Z","title":"EASY: Emotion-aware Speaker Anonymization via Factorized Distillation","version":2},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-07T15:30:35.813385Z"},"links":{"citing_paper":"/paper/2505.15004"},"observation_digest":"sha256:b22c046f842f393094c957482bcacfe6acef0f1c334cbbf78ff040aa4250c224","observation_id":"7d3bc3c6-f7b9-4d17-9c11-db7f28aacd36","resolution":{"observed_at":"2026-08-07T15:30:36.873028Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:30:36.858452Z","title":"Salt: Dis- tinguishable speaker anonymization through latent space transfor- mation,","venue":null,"work_id":"24260ada-470b-4ddc-86fb-236b99fd401b","year":2023},"citing_paper":{"arxiv_id":"2505.15004","last_updated":"2025-05-30T08:08:47Z","snapshot_observed_at":"2026-08-10T17:50:19.872730Z","submitted_at":"2025-05-21T01:17:09Z","title":"EASY: Emotion-aware Speaker Anonymization via Factorized Distillation","version":2},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-07T15:30:35.949038Z"},"links":{"citing_paper":"/paper/2505.15004"},"observation_digest":"sha256:15ae1bd042e6f0ec6de2c45f1cc3d0f07ab899fdce66740915237611306811fd","observation_id":"eb0be5cd-d109-4d0d-b926-0902266a4081","resolution":{"observed_at":"2026-08-07T15:30:36.862252Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2209.11969","last_updated":"2022-09-24T09:36:43Z","snapshot_observed_at":"2026-08-09T13:49:58.230718Z","submitted_at":"2022-09-24T09:36:43Z","title":"NWPU-ASLP System for the VoicePrivacy 2022 Challenge","version":1},"cited_work":{"arxiv_id":"2209.11969","doi":null,"metadata_source":"pith","pith_arxiv_id":"2209.11969","snapshot_observed_at":"2026-08-07T15:30:36.708828Z","title":"NWPU-ASLP System for the VoicePrivacy 2022 Challenge","venue":"eess.AS","work_id":"676cd58f-0b9c-4b73-ab74-57dbe9f741f9","year":2022},"citing_paper":{"arxiv_id":"2505.15004","last_updated":"2025-05-30T08:08:47Z","snapshot_observed_at":"2026-08-10T17:50:19.872730Z","submitted_at":"2025-05-21T01:17:09Z","title":"EASY: Emotion-aware Speaker Anonymization via Factorized Distillation","version":2},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-08-07T15:30:36.002336Z"},"links":{"cited_paper":"/paper/2209.11969","citing_paper":"/paper/2505.15004"},"observation_digest":"sha256:256803f71f5dd8eb75492ec5c4a957aeea7796da19a90e2d77997d6aede7f484","observation_id":"42ba75be-8371-4866-b3b4-c8deeb91e9e7","resolution":{"observed_at":"2026-08-07T15:30:36.715710Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2409.04173","last_updated":"2025-02-04T08:43:31Z","snapshot_observed_at":"2026-08-12T22:50:05.290534Z","submitted_at":"2024-09-06T10:32:42Z","title":"NPU-NTU System for Voice Privacy 2024 Challenge","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2409.04173","snapshot_observed_at":"2026-08-07T15:30:36.064371Z","title":"NPU-NTU system for voice privacy 2024 challenge,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.15004","last_updated":"2025-05-30T08:08:47Z","snapshot_observed_at":"2026-08-10T17:50:19.872730Z","submitted_at":"2025-05-21T01:17:09Z","title":"EASY: Emotion-aware Speaker Anonymization via Factorized Distillation","version":2},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-08-07T15:30:36.064371Z"},"links":{"cited_paper":"/paper/2409.04173","citing_paper":"/paper/2505.15004"},"observation_digest":"sha256:cbb0857e17b89b44328a66580833b942f9f849bc0e84a53bd406087389c6b496","observation_id":"ec6480a6-fcad-4548-bd3d-74723a45db51","resolution":{"observed_at":"2026-08-07T15:30:36.064371Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:30:36.073990Z","title":"WavLM: Large-scale self- supervised pre-training for full stack speech processing,","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2505.15004","last_updated":"2025-05-30T08:08:47Z","snapshot_observed_at":"2026-08-10T17:50:19.872730Z","submitted_at":"2025-05-21T01:17:09Z","title":"EASY: Emotion-aware Speaker Anonymization via Factorized Distillation","version":2},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-08-07T15:30:36.073990Z"},"links":{"citing_paper":"/paper/2505.15004"},"observation_digest":"sha256:162ec319007aac9994146a769e4e97d5255d4d3dc838dac68d56f5644ccc92be","observation_id":"820d4c77-a299-429b-8aa1-25d957227a7e","resolution":{"observed_at":"2026-08-07T15:30:36.073990Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2312.15185","last_updated":"2023-12-23T07:46:55Z","snapshot_observed_at":"2026-08-13T04:54:51.180904Z","submitted_at":"2023-12-23T07:46:55Z","title":"emotion2vec: Self-Supervised Pre-Training for Speech Emotion Representation","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2312.15185","snapshot_observed_at":"2026-08-07T15:30:36.078119Z","title":"Emotion2vec: Self-supervised pre-training for speech emotion representation,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.15004","last_updated":"2025-05-30T08:08:47Z","snapshot_observed_at":"2026-08-10T17:50:19.872730Z","submitted_at":"2025-05-21T01:17:09Z","title":"EASY: Emotion-aware Speaker Anonymization via Factorized Distillation","version":2},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-08-07T15:30:36.078119Z"},"links":{"cited_paper":"/paper/2312.15185","citing_paper":"/paper/2505.15004"},"observation_digest":"sha256:c3cd953550eccaee294b8c1d52648b4f3e613078dba8513747dbeff696b88553","observation_id":"4f619372-433f-4e44-baf3-81c64b1af81b","resolution":{"observed_at":"2026-08-07T15:30:36.078119Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:30:36.840185Z","title":"Language modeling with gated convolutional networks,","venue":null,"work_id":"a587101b-4140-4ea1-ac23-214eb1553070","year":2017},"citing_paper":{"arxiv_id":"2505.15004","last_updated":"2025-05-30T08:08:47Z","snapshot_observed_at":"2026-08-10T17:50:19.872730Z","submitted_at":"2025-05-21T01:17:09Z","title":"EASY: Emotion-aware Speaker Anonymization via Factorized Distillation","version":2},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-08-07T15:30:36.091664Z"},"links":{"citing_paper":"/paper/2505.15004"},"observation_digest":"sha256:509278f62281b2bee4d0de06f9c7aec7ae4bc36c3ac4d8bfd2ae42798d9a4842","observation_id":"8315c05d-acaa-4d8a-b8ca-094a9873eb14","resolution":{"observed_at":"2026-08-07T15:30:36.843689Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:30:36.186145Z","title":"Neural discrete representa- tion learning,","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2505.15004","last_updated":"2025-05-30T08:08:47Z","snapshot_observed_at":"2026-08-10T17:50:19.872730Z","submitted_at":"2025-05-21T01:17:09Z","title":"EASY: Emotion-aware Speaker Anonymization via Factorized Distillation","version":2},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-08-07T15:30:36.186145Z"},"links":{"citing_paper":"/paper/2505.15004"},"observation_digest":"sha256:c5db74d537a0a87b0f63c738745eebdeb07afc9412a57a6f015a571f07f14aa2","observation_id":"a03cb183-98be-45a1-b9d0-5eac9e45bd7b","resolution":{"observed_at":"2026-08-07T15:30:36.186145Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2308.16692","last_updated":"2024-01-23T01:56:57Z","snapshot_observed_at":"2026-08-07T03:22:13.424379Z","submitted_at":"2023-08-31T12:53:09Z","title":"SpeechTokenizer: Unified Speech Tokenizer for Speech Large Language Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2308.16692","snapshot_observed_at":"2026-08-07T15:30:36.244621Z","title":"Speechtok- enizer: Unified speech tokenizer for speech large language mod- els,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.15004","last_updated":"2025-05-30T08:08:47Z","snapshot_observed_at":"2026-08-10T17:50:19.872730Z","submitted_at":"2025-05-21T01:17:09Z","title":"EASY: Emotion-aware Speaker Anonymization via Factorized Distillation","version":2},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-08-07T15:30:36.244621Z"},"links":{"cited_paper":"/paper/2308.16692","citing_paper":"/paper/2505.15004"},"observation_digest":"sha256:794d6da44bf6528a2681f95aae7f69c707a7507dc369137bd5c49849b708c526","observation_id":"7fb72ea3-0c45-46da-8637-16335c415d8d","resolution":{"observed_at":"2026-08-07T15:30:36.244621Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:30:36.324730Z","title":"HiFi-GAN: Generative adversarial networks for efficient and high fidelity speech synthesis,","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2505.15004","last_updated":"2025-05-30T08:08:47Z","snapshot_observed_at":"2026-08-10T17:50:19.872730Z","submitted_at":"2025-05-21T01:17:09Z","title":"EASY: Emotion-aware Speaker Anonymization via Factorized Distillation","version":2},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-08-07T15:30:36.324730Z"},"links":{"citing_paper":"/paper/2505.15004"},"observation_digest":"sha256:c7d5d8477578f7594d8450b101d676be4ffa27267ee387efa8b57a45f886cf89","observation_id":"7d66a765-7a62-4447-a8fe-81d02f264211","resolution":{"observed_at":"2026-08-07T15:30:36.324730Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2305.02765","last_updated":"2023-05-07T09:22:04Z","snapshot_observed_at":"2026-08-06T10:45:04.364170Z","submitted_at":"2023-05-04T12:11:13Z","title":"HiFi-Codec: Group-residual Vector quantization for High Fidelity Audio Codec","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2305.02765","snapshot_observed_at":"2026-08-07T15:30:36.404353Z","title":"Hifi- codec: Group-residual vector quantization for high fidelity audio codec,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.15004","last_updated":"2025-05-30T08:08:47Z","snapshot_observed_at":"2026-08-10T17:50:19.872730Z","submitted_at":"2025-05-21T01:17:09Z","title":"EASY: Emotion-aware Speaker Anonymization via Factorized Distillation","version":2},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-08-07T15:30:36.404353Z"},"links":{"cited_paper":"/paper/2305.02765","citing_paper":"/paper/2505.15004"},"observation_digest":"sha256:2d405e8bb5dd3bc005cb090a6fdb87d6a2c65677ca5ca54be8491c5f8128c5ce","observation_id":"253a6c96-6aff-4fbb-b24d-1f91f865a911","resolution":{"observed_at":"2026-08-07T15:30:36.404353Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:30:36.816271Z","title":"Lib- riSpeech: an asr corpus based on public domain audio books,","venue":null,"work_id":"b3f7ef14-aa0a-4b64-b507-331fa204586d","year":2015},"citing_paper":{"arxiv_id":"2505.15004","last_updated":"2025-05-30T08:08:47Z","snapshot_observed_at":"2026-08-10T17:50:19.872730Z","submitted_at":"2025-05-21T01:17:09Z","title":"EASY: Emotion-aware Speaker Anonymization via Factorized Distillation","version":2},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-08-07T15:30:36.457247Z"},"links":{"citing_paper":"/paper/2505.15004"},"observation_digest":"sha256:b4f8ce0ac4fd1782616a579ab1846852afed83f5b89aa27115017f6638cc9bd4","observation_id":"74faf3e4-1d6c-4555-92c3-852891efc1ca","resolution":{"observed_at":"2026-08-07T15:30:36.819896Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1904.02882","last_updated":"2019-04-05T06:05:00Z","snapshot_observed_at":"2026-08-10T09:39:47.608323Z","submitted_at":"2019-04-05T06:05:00Z","title":"LibriTTS: A Corpus Derived from LibriSpeech for Text-to-Speech","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1904.02882","snapshot_observed_at":"2026-08-07T15:30:36.515701Z","title":"LibriTTS: A corpus derived from librispeech for text- to-speech,","venue":null,"work_id":null,"year":1904},"citing_paper":{"arxiv_id":"2505.15004","last_updated":"2025-05-30T08:08:47Z","snapshot_observed_at":"2026-08-10T17:50:19.872730Z","submitted_at":"2025-05-21T01:17:09Z","title":"EASY: Emotion-aware Speaker Anonymization via Factorized Distillation","version":2},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-08-07T15:30:36.515701Z"},"links":{"cited_paper":"/paper/1904.02882","citing_paper":"/paper/2505.15004"},"observation_digest":"sha256:bd23c9633b5f138a0760e3d223d64c2112e7791568b94030c082a0102ff9ea2b","observation_id":"b3295ebf-d24a-4ac1-b320-05d138f3d8b0","resolution":{"observed_at":"2026-08-07T15:30:36.515701Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:30:36.565042Z","title":"IEMOCAP: Interactive emotional dyadic motion capture database,","venue":null,"work_id":null,"year":2008},"citing_paper":{"arxiv_id":"2505.15004","last_updated":"2025-05-30T08:08:47Z","snapshot_observed_at":"2026-08-10T17:50:19.872730Z","submitted_at":"2025-05-21T01:17:09Z","title":"EASY: Emotion-aware Speaker Anonymization via Factorized Distillation","version":2},"reference_index":36,"source":"pdf_text","source_observed_at":"2026-08-07T15:30:36.565042Z"},"links":{"citing_paper":"/paper/2505.15004"},"observation_digest":"sha256:d29ab7dbb9c17b4f36babb65b81fe7235a2b03c3d1eea100832af6285c0841d1","observation_id":"e375618c-99d5-423f-a137-05f81a1e5d36","resolution":{"observed_at":"2026-08-07T15:30:36.565042Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2308.04455","last_updated":"2024-03-01T16:52:19Z","snapshot_observed_at":"2026-08-12T16:50:59.507687Z","submitted_at":"2023-08-05T16:14:17Z","title":"Anonymizing Speech: Evaluating and Designing Speaker Anonymization Techniques","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2308.04455","snapshot_observed_at":"2026-08-07T15:30:36.583819Z","title":"Anonymizing speech: Evaluating and de- signing speaker anonymization techniques,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.15004","last_updated":"2025-05-30T08:08:47Z","snapshot_observed_at":"2026-08-10T17:50:19.872730Z","submitted_at":"2025-05-21T01:17:09Z","title":"EASY: Emotion-aware Speaker Anonymization via Factorized Distillation","version":2},"reference_index":37,"source":"pdf_text","source_observed_at":"2026-08-07T15:30:36.583819Z"},"links":{"cited_paper":"/paper/2308.04455","citing_paper":"/paper/2505.15004"},"observation_digest":"sha256:ea0d34b5586b5c304ba69cd67e5d1a30659132be581ed6b9f8855e0eed901c00","observation_id":"9e779790-8d96-41b1-8f70-ae37354db7d8","resolution":{"observed_at":"2026-08-07T15:30:36.583819Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2409.08913","last_updated":"2024-09-17T14:39:44Z","snapshot_observed_at":"2026-08-13T06:29:49.322397Z","submitted_at":"2024-09-13T15:29:37Z","title":"HLTCOE JHU Submission to the Voice Privacy Challenge 2024","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2409.08913","snapshot_observed_at":"2026-08-07T15:30:36.587841Z","title":"Hltcoe jhu sub- mission to the voice privacy challenge 2024,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.15004","last_updated":"2025-05-30T08:08:47Z","snapshot_observed_at":"2026-08-10T17:50:19.872730Z","submitted_at":"2025-05-21T01:17:09Z","title":"EASY: Emotion-aware Speaker Anonymization via Factorized Distillation","version":2},"reference_index":38,"source":"pdf_text","source_observed_at":"2026-08-07T15:30:36.587841Z"},"links":{"cited_paper":"/paper/2409.08913","citing_paper":"/paper/2505.15004"},"observation_digest":"sha256:174800d11642acd6acef3e7b9d886e098f9b5e9bded3168138a43707cac4b200","observation_id":"587c064d-858a-46e7-95a2-8bdb903fa253","resolution":{"observed_at":"2026-08-07T15:30:36.587841Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:30:36.798804Z","title":"System descrip- tion: Speaker anonymization system with sentiment transfer and feature interpolation,","venue":null,"work_id":"ea5b9b8e-2e6c-4dc1-a02d-b8d73f85747f","year":2024},"citing_paper":{"arxiv_id":"2505.15004","last_updated":"2025-05-30T08:08:47Z","snapshot_observed_at":"2026-08-10T17:50:19.872730Z","submitted_at":"2025-05-21T01:17:09Z","title":"EASY: Emotion-aware Speaker Anonymization via Factorized Distillation","version":2},"reference_index":39,"source":"pdf_text","source_observed_at":"2026-08-07T15:30:36.600275Z"},"links":{"citing_paper":"/paper/2505.15004"},"observation_digest":"sha256:45cbe6680e505fa38e637817efd992403dc8ce1d0093c7442d35c831c7419d60","observation_id":"ee39ac8b-036c-4bec-8eeb-1295b0b96370","resolution":{"observed_at":"2026-08-07T15:30:36.802506Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}}],"paper":{"arxiv_id":"2505.15004","last_updated":"2025-05-30T08:08:47Z","latest_version":2,"primary_category":"eess.AS","snapshot_observed_at":"2026-08-10T17:50:19.872730Z","submitted_at":"2025-05-21T01:17:09Z","title":"EASY: Emotion-aware Speaker Anonymization via Factorized Distillation"},"reference_resolution":{"displayed":39,"state_counts":{"malformed_identifier":1,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":19,"verified_exact":3,"verified_fuzzy":16},"total_outbound_references":39},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"thesis":"As of 13 August 2026, this Paper Citation Record lists 39 of 39 outbound references and 2 inbound Pith citation observations for arXiv:2505.15004."}