{"as_of":"2026-08-13T10:30:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:b63565fad29f95bae55d65ab597e72aca59d959be47b2cf14e57b3e4a6889c61","coverage":[{"denominator":36,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":36,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-11T18:01:45.543391Z","state":"measured"},{"denominator":36,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":36,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-13T06:32:02.005865+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2412.08306/citation-record","integrity":"/paper/2412.08306/integrity","json":"/paper/2412.08306/citation-record.json","paper":"/paper/2412.08306"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T18:01:45.972522Z","title":null,"venue":null,"work_id":"ca9303b5-7e03-4e18-a027-58fa195b8d8d","year":1997},"citing_paper":{"arxiv_id":"2412.08306","last_updated":"2024-12-11T11:36:24Z","snapshot_observed_at":"2026-08-12T20:51:52.134329Z","submitted_at":"2024-12-11T11:36:24Z","title":"Evaluating the Impact of Discriminative and Generative E2E Speech Enhancement Models on Syllable Stress Preservation","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-11T18:01:45.414173Z"},"links":{"citing_paper":"/paper/2412.08306"},"observation_digest":"sha256:bbc0b37a15e3a30959fbbaff724fc8553c5cabe0eb2a9d4595afd1941fa0e90e","observation_id":"c813cf80-5030-4cf8-b33a-17e665f6b1dd","resolution":{"observed_at":"2026-08-11T18:01:45.976320Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T18:01:45.961372Z","title":"Classification of lexical stress using spectral and prosodic features for computer-assisted language learning systems,","venue":null,"work_id":"877ac1c6-8e53-46d9-91e2-772472f82feb","year":2015},"citing_paper":{"arxiv_id":"2412.08306","last_updated":"2024-12-11T11:36:24Z","snapshot_observed_at":"2026-08-12T20:51:52.134329Z","submitted_at":"2024-12-11T11:36:24Z","title":"Evaluating the Impact of Discriminative and Generative E2E Speech Enhancement Models on Syllable Stress Preservation","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-11T18:01:45.418182Z"},"links":{"citing_paper":"/paper/2412.08306"},"observation_digest":"sha256:41ad5fc7afaf425ab48378f7555b1e6dc3e13ceb0aea861580423dbf8db51928","observation_id":"520e0775-02d9-4757-8a08-a363f24b8d6a","resolution":{"observed_at":"2026-08-11T18:01:45.965399Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T18:01:45.948772Z","title":null,"venue":null,"work_id":"58ba7871-f47c-445a-9598-5a876b4c638d","year":2006},"citing_paper":{"arxiv_id":"2412.08306","last_updated":"2024-12-11T11:36:24Z","snapshot_observed_at":"2026-08-12T20:51:52.134329Z","submitted_at":"2024-12-11T11:36:24Z","title":"Evaluating the Impact of Discriminative and Generative E2E Speech Enhancement Models on Syllable Stress Preservation","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-11T18:01:45.421981Z"},"links":{"citing_paper":"/paper/2412.08306"},"observation_digest":"sha256:f15c9904e94e154106f4caa142ab14a902321a1b6b92ecac4b272b56630b5763","observation_id":"5838e5b4-57d8-4654-9184-55d89cf6f322","resolution":{"observed_at":"2026-08-11T18:01:45.952398Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T18:01:45.937235Z","title":"Speech enhancement with lstm recurrent neural networks and its application to noise-robust ASR,","venue":null,"work_id":"db3d2427-7ddb-434f-81bb-40df3b7c41f8","year":2015},"citing_paper":{"arxiv_id":"2412.08306","last_updated":"2024-12-11T11:36:24Z","snapshot_observed_at":"2026-08-12T20:51:52.134329Z","submitted_at":"2024-12-11T11:36:24Z","title":"Evaluating the Impact of Discriminative and Generative E2E Speech Enhancement Models on Syllable Stress Preservation","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-11T18:01:45.425931Z"},"links":{"citing_paper":"/paper/2412.08306"},"observation_digest":"sha256:f654c875e92a73cb68ba163019d42dc5ad9cfc531cd3711e75bf5222855dcd65","observation_id":"bdafc196-15c6-4c8d-9d86-5b7ccd88cb2b","resolution":{"observed_at":"2026-08-11T18:01:45.941421Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T18:01:45.927354Z","title":"Towards robust speech emotion recognition using deep residual networks for speech enhancement,","venue":null,"work_id":"5a35ef42-7970-4187-a9fe-62ce00c41dd6","year":2019},"citing_paper":{"arxiv_id":"2412.08306","last_updated":"2024-12-11T11:36:24Z","snapshot_observed_at":"2026-08-12T20:51:52.134329Z","submitted_at":"2024-12-11T11:36:24Z","title":"Evaluating the Impact of Discriminative and Generative E2E Speech Enhancement Models on Syllable Stress Preservation","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-11T18:01:45.430243Z"},"links":{"citing_paper":"/paper/2412.08306"},"observation_digest":"sha256:cc5b44ad2be78c2a10699441991dd2f0e3d908c486fb52fa292b3e51540c8261","observation_id":"30fda546-516a-4bab-971a-1ffc858944ad","resolution":{"observed_at":"2026-08-11T18:01:45.930533Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1709.01703","last_updated":"2017-09-07T06:07:30Z","snapshot_observed_at":"2026-08-12T20:52:19.942520Z","submitted_at":"2017-09-06T07:51:18Z","title":"Conditional Generative Adversarial Networks for Speech Enhancement and Noise-Robust Speaker Verification","version":2},"cited_work":{"arxiv_id":"1709.01703","doi":null,"metadata_source":"pith","pith_arxiv_id":"1709.01703","snapshot_observed_at":"2026-08-11T18:01:45.648164Z","title":"Conditional Generative Adversarial Networks for Speech Enhancement and Noise-Robust Speaker Verification","venue":"eess.AS","work_id":"ac6cd409-96b7-432b-b3e9-ca499830792b","year":2017},"citing_paper":{"arxiv_id":"2412.08306","last_updated":"2024-12-11T11:36:24Z","snapshot_observed_at":"2026-08-12T20:51:52.134329Z","submitted_at":"2024-12-11T11:36:24Z","title":"Evaluating the Impact of Discriminative and Generative E2E Speech Enhancement Models on Syllable Stress Preservation","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-11T18:01:45.434246Z"},"links":{"cited_paper":"/paper/1709.01703","citing_paper":"/paper/2412.08306"},"observation_digest":"sha256:befc3ed4d9f5fbf52ed8c8c5e85522cedfba03826ac6d9014eeebe0f19161ef3","observation_id":"7fb9d207-4105-4ab2-922e-52cad6f52065","resolution":{"observed_at":"2026-08-11T18:01:45.652571Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T18:01:45.917156Z","title":"SLIM prosodic module for learning activities in a foreign language,","venue":null,"work_id":"c7195280-c783-4816-bd28-b9bd4af15c88","year":1997},"citing_paper":{"arxiv_id":"2412.08306","last_updated":"2024-12-11T11:36:24Z","snapshot_observed_at":"2026-08-12T20:51:52.134329Z","submitted_at":"2024-12-11T11:36:24Z","title":"Evaluating the Impact of Discriminative and Generative E2E Speech Enhancement Models on Syllable Stress Preservation","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-11T18:01:45.438766Z"},"links":{"citing_paper":"/paper/2412.08306"},"observation_digest":"sha256:e1731f6a70c1cc3fe3ab424f4aa4fe62702d96591f69eeec7d507398b11a3601","observation_id":"022b7fa5-8220-4a72-96c4-710de65fea3c","resolution":{"observed_at":"2026-08-11T18:01:45.920479Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T18:01:45.905570Z","title":"Automatic syllable stress detection using prosodic features for pronunciation evaluation of language learners,","venue":null,"work_id":"dc38ab62-a987-4104-b738-21181aafdff4","year":2005},"citing_paper":{"arxiv_id":"2412.08306","last_updated":"2024-12-11T11:36:24Z","snapshot_observed_at":"2026-08-12T20:51:52.134329Z","submitted_at":"2024-12-11T11:36:24Z","title":"Evaluating the Impact of Discriminative and Generative E2E Speech Enhancement Models on Syllable Stress Preservation","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-11T18:01:45.442318Z"},"links":{"citing_paper":"/paper/2412.08306"},"observation_digest":"sha256:e40c7b321d4f4f4ff39abda8f572783a8f7a66c8a342877299af89de0be0d3a2","observation_id":"e57530f9-a75f-4e53-8a6a-64b3d3c68ac7","resolution":{"observed_at":"2026-08-11T18:01:45.910123Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T18:01:45.894112Z","title":"Automatic prominent syllable detection with machine learning classifiers,","venue":null,"work_id":"5a3575f4-25fa-489b-8019-0a293d2855d0","year":2015},"citing_paper":{"arxiv_id":"2412.08306","last_updated":"2024-12-11T11:36:24Z","snapshot_observed_at":"2026-08-12T20:51:52.134329Z","submitted_at":"2024-12-11T11:36:24Z","title":"Evaluating the Impact of Discriminative and Generative E2E Speech Enhancement Models on Syllable Stress Preservation","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-11T18:01:45.445928Z"},"links":{"citing_paper":"/paper/2412.08306"},"observation_digest":"sha256:e6c8497e89809217b07388afc81931fc76361fa9fd1cb3914784657e54f6988a","observation_id":"465432fe-dd0f-457f-a66b-4050c920bc14","resolution":{"observed_at":"2026-08-11T18:01:45.898406Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T18:01:45.882688Z","title":"An Attention Based Deep Neural Network for Automatic Lexical Stress Detection,","venue":null,"work_id":"e9e4c2ac-bde4-4a75-857d-7b73ea2d0c53","year":2019},"citing_paper":{"arxiv_id":"2412.08306","last_updated":"2024-12-11T11:36:24Z","snapshot_observed_at":"2026-08-12T20:51:52.134329Z","submitted_at":"2024-12-11T11:36:24Z","title":"Evaluating the Impact of Discriminative and Generative E2E Speech Enhancement Models on Syllable Stress Preservation","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-11T18:01:45.449501Z"},"links":{"citing_paper":"/paper/2412.08306"},"observation_digest":"sha256:449e21f8e00bbb704ab7966230d660e0e5e70f643166efa739fc87993d85a55f","observation_id":"1a9be29a-0a2d-4602-8fbf-691ca703a660","resolution":{"observed_at":"2026-08-11T18:01:45.886399Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1911.04862","last_updated":"2019-11-06T11:29:37Z","snapshot_observed_at":"2026-07-06T08:36:24.990567Z","submitted_at":"2019-11-06T11:29:37Z","title":"An End-to-end Approach for Lexical Stress Detection based on Transformer","version":1},"cited_work":{"arxiv_id":"1911.04862","doi":null,"metadata_source":"pith","pith_arxiv_id":"1911.04862","snapshot_observed_at":"2026-08-11T18:01:45.632674Z","title":"An End-to-end Approach for Lexical Stress Detection based on Transformer","venue":"eess.AS","work_id":"a2064626-f92a-4b46-8649-ec1918180904","year":2019},"citing_paper":{"arxiv_id":"2412.08306","last_updated":"2024-12-11T11:36:24Z","snapshot_observed_at":"2026-08-12T20:51:52.134329Z","submitted_at":"2024-12-11T11:36:24Z","title":"Evaluating the Impact of Discriminative and Generative E2E Speech Enhancement Models on Syllable Stress Preservation","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-11T18:01:45.453256Z"},"links":{"cited_paper":"/paper/1911.04862","citing_paper":"/paper/2412.08306"},"observation_digest":"sha256:564184e145b51f927955b3819fe4d404bc0ad7e8b2fa5ee9fd6e5d1a87d14cf5","observation_id":"fd9fb64a-6182-40a7-9450-16c228d21fba","resolution":{"observed_at":"2026-08-11T18:01:45.636790Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T18:01:45.870621Z","title":"A compar- ison of learned representations with jointly optimized vae and dnn for syllable stress detection,","venue":null,"work_id":"76530cd8-5e63-4162-b58a-1adb6de50009","year":2023},"citing_paper":{"arxiv_id":"2412.08306","last_updated":"2024-12-11T11:36:24Z","snapshot_observed_at":"2026-08-12T20:51:52.134329Z","submitted_at":"2024-12-11T11:36:24Z","title":"Evaluating the Impact of Discriminative and Generative E2E Speech Enhancement Models on Syllable Stress Preservation","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-11T18:01:45.457627Z"},"links":{"citing_paper":"/paper/2412.08306"},"observation_digest":"sha256:e5440768dcee63b0c8d2310f1a9f25673f626f4827fd748dbdbd1d03fe974bcd","observation_id":"e59973ce-6058-4040-8648-b8b7c3cec32f","resolution":{"observed_at":"2026-08-11T18:01:45.874565Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T18:01:45.858519Z","title":"The ISLE corpus of non-native spoken English,","venue":null,"work_id":"a0fc8c96-65b0-4bda-b008-9b97f1466eeb","year":2000},"citing_paper":{"arxiv_id":"2412.08306","last_updated":"2024-12-11T11:36:24Z","snapshot_observed_at":"2026-08-12T20:51:52.134329Z","submitted_at":"2024-12-11T11:36:24Z","title":"Evaluating the Impact of Discriminative and Generative E2E Speech Enhancement Models on Syllable Stress Preservation","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-11T18:01:45.461887Z"},"links":{"citing_paper":"/paper/2412.08306"},"observation_digest":"sha256:ae622c4239e11a983fe2659d2e30f8897d33778fcf2bf964f3f581bfd8297a65","observation_id":"b03fb486-12b9-4f5a-8c8b-e36712302239","resolution":{"observed_at":"2026-08-11T18:01:45.863238Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T18:01:45.845629Z","title":"Automatic detection of syllable stress using sonority based prominence features for pronunciation evaluation,","venue":null,"work_id":"8d9bc76e-3c00-4726-9186-21e3442ac59d","year":2017},"citing_paper":{"arxiv_id":"2412.08306","last_updated":"2024-12-11T11:36:24Z","snapshot_observed_at":"2026-08-12T20:51:52.134329Z","submitted_at":"2024-12-11T11:36:24Z","title":"Evaluating the Impact of Discriminative and Generative E2E Speech Enhancement Models on Syllable Stress Preservation","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-11T18:01:45.465583Z"},"links":{"citing_paper":"/paper/2412.08306"},"observation_digest":"sha256:1eef60823067c26aa987675de7b2c84f4ec42c4e9767362090dd56dc0b2e3b42","observation_id":"b489738f-4b14-4d3a-82cc-86c997ab90f6","resolution":{"observed_at":"2026-08-11T18:01:45.849671Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T18:01:45.835645Z","title":"Comparison of automatic syllable stress detection quality with time-aligned boundaries and context dependencies,","venue":null,"work_id":"47384d8e-4cfd-4972-92d9-56b17e7f4abc","year":2019},"citing_paper":{"arxiv_id":"2412.08306","last_updated":"2024-12-11T11:36:24Z","snapshot_observed_at":"2026-08-12T20:51:52.134329Z","submitted_at":"2024-12-11T11:36:24Z","title":"Evaluating the Impact of Discriminative and Generative E2E Speech Enhancement Models on Syllable Stress Preservation","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-11T18:01:45.469292Z"},"links":{"citing_paper":"/paper/2412.08306"},"observation_digest":"sha256:dc16920339d45df360deb1ee91b62e507343166060d562802a264aab854ce98e","observation_id":"e5a30a82-ab85-43ce-8847-58633a92be9f","resolution":{"observed_at":"2026-08-11T18:01:45.838997Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T18:01:45.473029Z","title":"wav2vec 2.0: A framework for self-supervised learning of speech representations,","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2412.08306","last_updated":"2024-12-11T11:36:24Z","snapshot_observed_at":"2026-08-12T20:51:52.134329Z","submitted_at":"2024-12-11T11:36:24Z","title":"Evaluating the Impact of Discriminative and Generative E2E Speech Enhancement Models on Syllable Stress Preservation","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-11T18:01:45.473029Z"},"links":{"citing_paper":"/paper/2412.08306"},"observation_digest":"sha256:0f32fe16e969592068a0b353c07143757c6182e9fccd70e2e6a2a52fab7fc2ae","observation_id":"87613730-d866-43d1-a29f-8abdd4115c5b","resolution":{"observed_at":"2026-08-11T18:01:45.473029Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T18:01:45.815516Z","title":"Hubert: Self- supervised speech representation learning by masked prediction of hidden units,","venue":null,"work_id":"d4dacb5b-cfed-484b-b46a-03a9a3bc7b55","year":2021},"citing_paper":{"arxiv_id":"2412.08306","last_updated":"2024-12-11T11:36:24Z","snapshot_observed_at":"2026-08-12T20:51:52.134329Z","submitted_at":"2024-12-11T11:36:24Z","title":"Evaluating the Impact of Discriminative and Generative E2E Speech Enhancement Models on Syllable Stress Preservation","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-11T18:01:45.476562Z"},"links":{"citing_paper":"/paper/2412.08306"},"observation_digest":"sha256:8b880ccdc13d9408aee09d2e269b1ff089b2ff68ea8077422f0c2df8a7d65034","observation_id":"0413e040-8369-4c82-adb9-9fdbe37e98ae","resolution":{"observed_at":"2026-08-11T18:01:45.819980Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T18:01:45.800716Z","title":"Multi-lingual multi-task speech emotion recognition using wav2vec 2.0,","venue":null,"work_id":"98ccc47a-0a7d-41ce-9d31-e59f45a3797c","year":2022},"citing_paper":{"arxiv_id":"2412.08306","last_updated":"2024-12-11T11:36:24Z","snapshot_observed_at":"2026-08-12T20:51:52.134329Z","submitted_at":"2024-12-11T11:36:24Z","title":"Evaluating the Impact of Discriminative and Generative E2E Speech Enhancement Models on Syllable Stress Preservation","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-11T18:01:45.479724Z"},"links":{"citing_paper":"/paper/2412.08306"},"observation_digest":"sha256:fba6ec0b9874a6ed580a2900597036d119ae54141986bdc46025ecc36873dff4","observation_id":"f0b56a61-8a58-462f-9b29-4da926c1f1ca","resolution":{"observed_at":"2026-08-11T18:01:45.804844Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2111.02735","last_updated":"2022-10-03T20:50:54Z","snapshot_observed_at":"2026-08-11T00:21:42.076457Z","submitted_at":"2021-11-04T10:39:06Z","title":"A Fine-tuned Wav2vec 2.0/HuBERT Benchmark For Speech Emotion Recognition, Speaker Verification and Spoken Language Understanding","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2111.02735","snapshot_observed_at":"2026-08-11T18:01:45.483468Z","title":"A fine-tuned wav2vec 2.0/hubert benchmark for speech emotion recogni- tion, speaker verification and spoken language understanding,","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2412.08306","last_updated":"2024-12-11T11:36:24Z","snapshot_observed_at":"2026-08-12T20:51:52.134329Z","submitted_at":"2024-12-11T11:36:24Z","title":"Evaluating the Impact of Discriminative and Generative E2E Speech Enhancement Models on Syllable Stress Preservation","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-11T18:01:45.483468Z"},"links":{"cited_paper":"/paper/2111.02735","citing_paper":"/paper/2412.08306"},"observation_digest":"sha256:dd87af6cd336569ea350ac3ae17cb013e73cf1722beb24df2f8663998059945c","observation_id":"f1e94387-1dda-4d75-bd24-99ceceb379fd","resolution":{"observed_at":"2026-08-11T18:01:45.483468Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T18:01:45.789310Z","title":"Exploring the use of self-supervised representations for automatic syllable stress detection,","venue":null,"work_id":"c6b841cf-6e4e-4029-9830-279f81444b04","year":2024},"citing_paper":{"arxiv_id":"2412.08306","last_updated":"2024-12-11T11:36:24Z","snapshot_observed_at":"2026-08-12T20:51:52.134329Z","submitted_at":"2024-12-11T11:36:24Z","title":"Evaluating the Impact of Discriminative and Generative E2E Speech Enhancement Models on Syllable Stress Preservation","version":1},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-11T18:01:45.486750Z"},"links":{"citing_paper":"/paper/2412.08306"},"observation_digest":"sha256:ca6c2baa19787e32a1f754a6ff5284e7a504866ac8d2b4547507d2561a0e20c9","observation_id":"86868026-b868-4162-b636-c407cef57099","resolution":{"observed_at":"2026-08-11T18:01:45.793208Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T18:01:45.777573Z","title":"Conv-tasnet: Surpassing ideal time– frequency magnitude masking for speech separation,","venue":null,"work_id":"5ff939a3-7838-4bd9-b851-ab2aaa1d0248","year":2019},"citing_paper":{"arxiv_id":"2412.08306","last_updated":"2024-12-11T11:36:24Z","snapshot_observed_at":"2026-08-12T20:51:52.134329Z","submitted_at":"2024-12-11T11:36:24Z","title":"Evaluating the Impact of Discriminative and Generative E2E Speech Enhancement Models on Syllable Stress Preservation","version":1},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-11T18:01:45.489814Z"},"links":{"citing_paper":"/paper/2412.08306"},"observation_digest":"sha256:5ec5da9b92c85b7231485d30bbafce977e558a642217f504edbc4aac4da54de0","observation_id":"900ed1ea-dbdc-41b6-a73d-f730ab010ee8","resolution":{"observed_at":"2026-08-11T18:01:45.781591Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T18:01:45.765455Z","title":"Real-time single-channel dereverbera- tion and separation with time-domain audio separation network.,","venue":null,"work_id":"f3ab1017-3521-4c92-a03c-458684c89521","year":2018},"citing_paper":{"arxiv_id":"2412.08306","last_updated":"2024-12-11T11:36:24Z","snapshot_observed_at":"2026-08-12T20:51:52.134329Z","submitted_at":"2024-12-11T11:36:24Z","title":"Evaluating the Impact of Discriminative and Generative E2E Speech Enhancement Models on Syllable Stress Preservation","version":1},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-11T18:01:45.492977Z"},"links":{"citing_paper":"/paper/2412.08306"},"observation_digest":"sha256:cf272f982ef1b45489c42c3b9fbea9e5f2605e4dfaec0939576bec019ec210be","observation_id":"ca39b5ce-0a08-4823-96e6-68e02518e66c","resolution":{"observed_at":"2026-08-11T18:01:45.769382Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T18:01:45.495944Z","title":"U-net: Con- volutional networks for biomedical image segmentation,","venue":null,"work_id":null,"year":2015},"citing_paper":{"arxiv_id":"2412.08306","last_updated":"2024-12-11T11:36:24Z","snapshot_observed_at":"2026-08-12T20:51:52.134329Z","submitted_at":"2024-12-11T11:36:24Z","title":"Evaluating the Impact of Discriminative and Generative E2E Speech Enhancement Models on Syllable Stress Preservation","version":1},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-11T18:01:45.495944Z"},"links":{"citing_paper":"/paper/2412.08306"},"observation_digest":"sha256:747fb8df6beec227a6bbe653d0ed2b0e795d9037efbe5dd3347ba9db5eff00f8","observation_id":"140c2dba-9105-4fb9-ae09-ebcde707dc79","resolution":{"observed_at":"2026-08-11T18:01:45.495944Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T18:01:45.747948Z","title":"Tasnet: time-domain audio separation network for real-time, single-channel speech separation,","venue":null,"work_id":"b063d720-9068-4b44-94d1-cfe63fa79ab0","year":2018},"citing_paper":{"arxiv_id":"2412.08306","last_updated":"2024-12-11T11:36:24Z","snapshot_observed_at":"2026-08-12T20:51:52.134329Z","submitted_at":"2024-12-11T11:36:24Z","title":"Evaluating the Impact of Discriminative and Generative E2E Speech Enhancement Models on Syllable Stress Preservation","version":1},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-11T18:01:45.498955Z"},"links":{"citing_paper":"/paper/2412.08306"},"observation_digest":"sha256:ee03b4c934a6e7e51829f99a01f0f1830410fa4dda6f22c297b9d57a70c9e16c","observation_id":"38ba5986-d49f-4269-8ebb-8773891998eb","resolution":{"observed_at":"2026-08-11T18:01:45.751948Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T18:01:45.736364Z","title":"Conditional diffusion probabilistic model for speech enhancement,","venue":null,"work_id":"b276ad0a-20bf-4c0d-ab35-a1bdc4e43a24","year":2022},"citing_paper":{"arxiv_id":"2412.08306","last_updated":"2024-12-11T11:36:24Z","snapshot_observed_at":"2026-08-12T20:51:52.134329Z","submitted_at":"2024-12-11T11:36:24Z","title":"Evaluating the Impact of Discriminative and Generative E2E Speech Enhancement Models on Syllable Stress Preservation","version":1},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-08-11T18:01:45.501878Z"},"links":{"citing_paper":"/paper/2412.08306"},"observation_digest":"sha256:a05a9ab110b62a12214871ad97394fe872c661e8edea4f93257cc1cd85e7a514","observation_id":"d25ae8c9-6e10-44c6-9cbe-acd57126371f","resolution":{"observed_at":"2026-08-11T18:01:45.740413Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2005.07551","last_updated":"2020-10-22T15:29:44Z","snapshot_observed_at":"2026-07-06T09:20:38.420360Z","submitted_at":"2020-05-15T14:04:33Z","title":"Dual-Signal Transformation LSTM Network for Real-Time Noise Suppression","version":2},"cited_work":{"arxiv_id":"2005.07551","doi":null,"metadata_source":"pith","pith_arxiv_id":"2005.07551","snapshot_observed_at":"2026-08-11T18:01:45.605838Z","title":"Dual-Signal Transformation LSTM Network for Real-Time Noise Suppression","venue":"eess.AS","work_id":"dabbb6cc-c1a2-4419-b5e1-ce528563eae8","year":2020},"citing_paper":{"arxiv_id":"2412.08306","last_updated":"2024-12-11T11:36:24Z","snapshot_observed_at":"2026-08-12T20:51:52.134329Z","submitted_at":"2024-12-11T11:36:24Z","title":"Evaluating the Impact of Discriminative and Generative E2E Speech Enhancement Models on Syllable Stress Preservation","version":1},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-08-11T18:01:45.505315Z"},"links":{"cited_paper":"/paper/2005.07551","citing_paper":"/paper/2412.08306"},"observation_digest":"sha256:1c712a6687a2a3e153fdfb35854cd8f33fa064f9f2fb21ae4de7cd66b7ce877a","observation_id":"6febedc3-1816-4266-bece-725c599bea8a","resolution":{"observed_at":"2026-08-11T18:01:45.612305Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T18:01:45.509317Z","title":"Librispeech: an asr corpus based on public domain audio books,","venue":null,"work_id":null,"year":2015},"citing_paper":{"arxiv_id":"2412.08306","last_updated":"2024-12-11T11:36:24Z","snapshot_observed_at":"2026-08-12T20:51:52.134329Z","submitted_at":"2024-12-11T11:36:24Z","title":"Evaluating the Impact of Discriminative and Generative E2E Speech Enhancement Models on Syllable Stress Preservation","version":1},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-08-11T18:01:45.509317Z"},"links":{"citing_paper":"/paper/2412.08306"},"observation_digest":"sha256:a705a85d6e8fa63861abfcf73d9bd48a27b7d85d245a51628555675b2a5a9484","observation_id":"d2a9969f-bc3d-448d-9e7f-2207893b59f5","resolution":{"observed_at":"2026-08-11T18:01:45.509317Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T18:01:45.718002Z","title":"Audio set: An ontology and human-labeled dataset for audio events,","venue":null,"work_id":"fadfdee6-c89e-48fc-bb1e-dba500e491fb","year":2017},"citing_paper":{"arxiv_id":"2412.08306","last_updated":"2024-12-11T11:36:24Z","snapshot_observed_at":"2026-08-12T20:51:52.134329Z","submitted_at":"2024-12-11T11:36:24Z","title":"Evaluating the Impact of Discriminative and Generative E2E Speech Enhancement Models on Syllable Stress Preservation","version":1},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-08-11T18:01:45.512829Z"},"links":{"citing_paper":"/paper/2412.08306"},"observation_digest":"sha256:8345d3efd1f78d36f2048cb0b2ce7d6776a6c4d5938e7768704221949f7e6b1c","observation_id":"09cecc1d-516c-446f-92ee-3ff860578fd8","resolution":{"observed_at":"2026-08-11T18:01:45.722836Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T18:01:45.707460Z","title":"The di- verse environments multi-channel acoustic noise database (demand): A database of multichannel environmental noise recordings,","venue":null,"work_id":"7846088c-e1a3-4601-841d-833081acdde9","year":2013},"citing_paper":{"arxiv_id":"2412.08306","last_updated":"2024-12-11T11:36:24Z","snapshot_observed_at":"2026-08-12T20:51:52.134329Z","submitted_at":"2024-12-11T11:36:24Z","title":"Evaluating the Impact of Discriminative and Generative E2E Speech Enhancement Models on Syllable Stress Preservation","version":1},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-08-11T18:01:45.516694Z"},"links":{"citing_paper":"/paper/2412.08306"},"observation_digest":"sha256:1fbc91e95282528f764dbb2954590564771ad08624386727c44708805d686a6e","observation_id":"5bd1b9eb-ab91-4d6d-a71a-e2956e6a4ef6","resolution":{"observed_at":"2026-08-11T18:01:45.710802Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1911.13254","last_updated":"2021-04-28T14:37:48Z","snapshot_observed_at":"2026-08-10T13:57:00.836098Z","submitted_at":"2019-11-27T13:50:45Z","title":"Music Source Separation in the Waveform Domain","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1911.13254","snapshot_observed_at":"2026-08-11T18:01:45.520297Z","title":"Music source separation in the waveform domain,","venue":null,"work_id":null,"year":1911},"citing_paper":{"arxiv_id":"2412.08306","last_updated":"2024-12-11T11:36:24Z","snapshot_observed_at":"2026-08-12T20:51:52.134329Z","submitted_at":"2024-12-11T11:36:24Z","title":"Evaluating the Impact of Discriminative and Generative E2E Speech Enhancement Models on Syllable Stress Preservation","version":1},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-08-11T18:01:45.520297Z"},"links":{"cited_paper":"/paper/1911.13254","citing_paper":"/paper/2412.08306"},"observation_digest":"sha256:ac870067b0de0e5c72ff581a927df02a4e2f9fc821df3519997b6754b1f176fc","observation_id":"680f913d-f745-4c46-a3ed-eade7fd07406","resolution":{"observed_at":"2026-08-11T18:01:45.520297Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2006.12847","last_updated":"2020-09-06T14:32:59Z","snapshot_observed_at":"2026-08-12T20:51:21.885876Z","submitted_at":"2020-06-23T09:19:13Z","title":"Real Time Speech Enhancement in the Waveform Domain","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2006.12847","snapshot_observed_at":"2026-08-11T18:01:45.524228Z","title":"Real time speech enhancement in the waveform domain,","venue":null,"work_id":null,"year":2006},"citing_paper":{"arxiv_id":"2412.08306","last_updated":"2024-12-11T11:36:24Z","snapshot_observed_at":"2026-08-12T20:51:52.134329Z","submitted_at":"2024-12-11T11:36:24Z","title":"Evaluating the Impact of Discriminative and Generative E2E Speech Enhancement Models on Syllable Stress Preservation","version":1},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-08-11T18:01:45.524228Z"},"links":{"cited_paper":"/paper/2006.12847","citing_paper":"/paper/2412.08306"},"observation_digest":"sha256:2b2b4285e2f891510a4e4c646d184d0547c289c7aa60f752af057ce86adba053","observation_id":"d18656fa-b7f5-4f06-bcfe-490d8ac71dd2","resolution":{"observed_at":"2026-08-11T18:01:45.524228Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T18:01:45.696727Z","title":"Noisy speech database for training speech enhancement algorithms and tts models,","venue":null,"work_id":"75734e40-57cd-4789-96b7-5be567fc6e80","year":2017},"citing_paper":{"arxiv_id":"2412.08306","last_updated":"2024-12-11T11:36:24Z","snapshot_observed_at":"2026-08-12T20:51:52.134329Z","submitted_at":"2024-12-11T11:36:24Z","title":"Evaluating the Impact of Discriminative and Generative E2E Speech Enhancement Models on Syllable Stress Preservation","version":1},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-08-11T18:01:45.528363Z"},"links":{"citing_paper":"/paper/2412.08306"},"observation_digest":"sha256:89e0999c91753a98064a968fc61af44086bf9cae3727b32fde664cd55ec82add","observation_id":"7ea2faf2-a87a-4911-aebc-82cabbe7a6b1","resolution":{"observed_at":"2026-08-11T18:01:45.700386Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2005.13981","last_updated":"2020-10-18T04:36:21Z","snapshot_observed_at":"2026-07-31T23:56:07.410341Z","submitted_at":"2020-05-16T23:48:37Z","title":"The INTERSPEECH 2020 Deep Noise Suppression Challenge: Datasets, Subjective Testing Framework, and Challenge Results","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2005.13981","snapshot_observed_at":"2026-08-11T18:01:45.532474Z","title":"The interspeech 2020 deep noise suppression challenge: Datasets, subjective testing framework, and challenge results,","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2412.08306","last_updated":"2024-12-11T11:36:24Z","snapshot_observed_at":"2026-08-12T20:51:52.134329Z","submitted_at":"2024-12-11T11:36:24Z","title":"Evaluating the Impact of Discriminative and Generative E2E Speech Enhancement Models on Syllable Stress Preservation","version":1},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-08-11T18:01:45.532474Z"},"links":{"cited_paper":"/paper/2005.13981","citing_paper":"/paper/2412.08306"},"observation_digest":"sha256:0880bd62404019059a5abd1cfaa253cce2e4d469bfb5c4183757e1d778d13e58","observation_id":"7ae9bdcf-6bbe-42cc-a5ff-f6e3f95f22b6","resolution":{"observed_at":"2026-08-11T18:01:45.532474Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T18:01:45.685034Z","title":"Deep unsupervised learning using nonequilibrium thermody- namics,","venue":null,"work_id":"edfe4ae4-e80b-48b8-95e2-2706b6f55247","year":2015},"citing_paper":{"arxiv_id":"2412.08306","last_updated":"2024-12-11T11:36:24Z","snapshot_observed_at":"2026-08-12T20:51:52.134329Z","submitted_at":"2024-12-11T11:36:24Z","title":"Evaluating the Impact of Discriminative and Generative E2E Speech Enhancement Models on Syllable Stress Preservation","version":1},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-08-11T18:01:45.536320Z"},"links":{"citing_paper":"/paper/2412.08306"},"observation_digest":"sha256:88b7b3fa7a3e6ff353a366da0f89435d850da1bab61cf85393fcc5ee35c49e7d","observation_id":"0f48d5d6-701e-4a65-9dd8-8c6a5abfc47b","resolution":{"observed_at":"2026-08-11T18:01:45.688509Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T18:01:45.673587Z","title":"Investigating RNN-based speech enhancement methods for noise-robust text-to-speech.,","venue":null,"work_id":"6838bfe2-2009-44b6-b81f-bfac6ba6313b","year":2016},"citing_paper":{"arxiv_id":"2412.08306","last_updated":"2024-12-11T11:36:24Z","snapshot_observed_at":"2026-08-12T20:51:52.134329Z","submitted_at":"2024-12-11T11:36:24Z","title":"Evaluating the Impact of Discriminative and Generative E2E Speech Enhancement Models on Syllable Stress Preservation","version":1},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-08-11T18:01:45.539819Z"},"links":{"citing_paper":"/paper/2412.08306"},"observation_digest":"sha256:43d45181a434200f4a97c575635ea08c06b3167773ba8e1e0a3df24bc141675a","observation_id":"cb191950-a0fa-445e-a677-ae815ded3e1d","resolution":{"observed_at":"2026-08-11T18:01:45.677767Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T18:01:45.661844Z","title":"The voice bank corpus: Design, collection and data analysis of a large regional accent speech database,","venue":null,"work_id":"35f67d0a-bae9-435f-8b44-02b24526380d","year":2013},"citing_paper":{"arxiv_id":"2412.08306","last_updated":"2024-12-11T11:36:24Z","snapshot_observed_at":"2026-08-12T20:51:52.134329Z","submitted_at":"2024-12-11T11:36:24Z","title":"Evaluating the Impact of Discriminative and Generative E2E Speech Enhancement Models on Syllable Stress Preservation","version":1},"reference_index":36,"source":"pdf_text","source_observed_at":"2026-08-11T18:01:45.543391Z"},"links":{"citing_paper":"/paper/2412.08306"},"observation_digest":"sha256:ce3a65cee98c1111c80cdd2a66e97511477c480869988a4f783eb0c4488acc82","observation_id":"93cc4da0-aa29-45b0-b7b5-9021059e34da","resolution":{"observed_at":"2026-08-11T18:01:45.666030Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}}],"paper":{"arxiv_id":"2412.08306","last_updated":"2024-12-11T11:36:24Z","latest_version":1,"primary_category":"eess.AS","snapshot_observed_at":"2026-08-12T20:51:52.134329Z","submitted_at":"2024-12-11T11:36:24Z","title":"Evaluating the Impact of Discriminative and Generative E2E Speech Enhancement Models on Syllable Stress Preservation"},"reference_resolution":{"displayed":36,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":9,"verified_exact":3,"verified_fuzzy":24},"total_outbound_references":36},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"thesis":"As of 13 August 2026, this Paper Citation Record lists 36 of 36 outbound references and 0 inbound Pith citation observations for arXiv:2412.08306."}