{"as_of":"2026-08-10T06:20:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:b2bba84daa2a30687df4aeb4f7f0c6ee9ea82fa18dc240a5c3b53edafa4ae032","coverage":[{"denominator":40,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":40,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-08T14:47:08.014339Z","state":"measured"},{"denominator":40,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":40,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-09T06:31:02.800959+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2502.06664/citation-record","integrity":"/paper/2502.06664/integrity","json":"/paper/2502.06664/citation-record.json","paper":"/paper/2502.06664"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T14:47:09.099615Z","title":"World report on hearing,","venue":null,"work_id":"58487886-a99f-4b7a-afad-22cc44bde0bd","year":2021},"citing_paper":{"arxiv_id":"2502.06664","last_updated":"2025-02-24T10:07:54Z","snapshot_observed_at":"2026-08-08T14:41:57.380685Z","submitted_at":"2025-02-10T16:51:11Z","title":"Evaluation of Deep Audio Representations for Hearables","version":2},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-08T14:47:07.836571Z"},"links":{"citing_paper":"/paper/2502.06664"},"observation_digest":"sha256:09be1c189cccddddebd03ccad5368959a1b42a1551343491e6c082887756c782","observation_id":"eb7c0932-bdf9-4b19-a40c-f0180cc9e3a8","resolution":{"observed_at":"2026-08-08T14:47:09.104164Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T14:47:07.841990Z","title":"Hearing loss in adults,","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2502.06664","last_updated":"2025-02-24T10:07:54Z","snapshot_observed_at":"2026-08-08T14:41:57.380685Z","submitted_at":"2025-02-10T16:51:11Z","title":"Evaluation of Deep Audio Representations for Hearables","version":2},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-08T14:47:07.841990Z"},"links":{"citing_paper":"/paper/2502.06664"},"observation_digest":"sha256:d253f2c81eb5f20f168a4b93a0d4f4d6ece8555feb995879b26f1b696e36eb65","observation_id":"553d561c-fbff-45f4-a85b-fbd72747b7e5","resolution":{"observed_at":"2026-08-08T14:47:07.841990Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T14:47:09.031675Z","title":"Hearing loss is associated with cortical thinning in cognitively normal older adults,","venue":null,"work_id":"dfc94282-bad3-441b-9553-4ceea6ea85fe","year":2020},"citing_paper":{"arxiv_id":"2502.06664","last_updated":"2025-02-24T10:07:54Z","snapshot_observed_at":"2026-08-08T14:41:57.380685Z","submitted_at":"2025-02-10T16:51:11Z","title":"Evaluation of Deep Audio Representations for Hearables","version":2},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-08T14:47:07.846757Z"},"links":{"citing_paper":"/paper/2502.06664"},"observation_digest":"sha256:b7afcc2d86fb2e4811a228f4070822fa6490a69909b78413b46c2a785408fc8a","observation_id":"af88bc24-03ab-422b-95bf-cee599bc7ef3","resolution":{"observed_at":"2026-08-08T14:47:09.061665Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T14:47:08.953045Z","title":"Impairments in hearing and vision impact on mortality in older people: the ages-reykjavik study,","venue":null,"work_id":"883e8e37-1cfd-4101-a26e-2502d55c0121","year":2014},"citing_paper":{"arxiv_id":"2502.06664","last_updated":"2025-02-24T10:07:54Z","snapshot_observed_at":"2026-08-08T14:41:57.380685Z","submitted_at":"2025-02-10T16:51:11Z","title":"Evaluation of Deep Audio Representations for Hearables","version":2},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-08T14:47:07.851732Z"},"links":{"citing_paper":"/paper/2502.06664"},"observation_digest":"sha256:e4438916dc11b71b503e091132cb84e8068e56265148a4103a0ba88a6f11d3db","observation_id":"ce4b6935-1c04-4235-9ddb-7680f4539520","resolution":{"observed_at":"2026-08-08T14:47:08.999246Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T14:47:08.888032Z","title":"Us population data on hearing loss, trouble hearing, and hearing-device use in adults: National health and nutrition examination survey, 2011–12, 2015–16, and 2017–20,","venue":null,"work_id":"18c163a7-b39c-4ab4-bf08-71e50f901bdc","year":2011},"citing_paper":{"arxiv_id":"2502.06664","last_updated":"2025-02-24T10:07:54Z","snapshot_observed_at":"2026-08-08T14:41:57.380685Z","submitted_at":"2025-02-10T16:51:11Z","title":"Evaluation of Deep Audio Representations for Hearables","version":2},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-08T14:47:07.856159Z"},"links":{"citing_paper":"/paper/2502.06664"},"observation_digest":"sha256:c7bd1aca9b786ea5eb1538734b9afe551ae9f246e17798557f86d6d71ae4adb7","observation_id":"33b0331e-4e10-4a7d-ace1-d83be13824a3","resolution":{"observed_at":"2026-08-08T14:47:08.919605Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T14:47:08.857094Z","title":"Emerging technologies, market segments, and marketrak 10 insights in hearing health technology,","venue":null,"work_id":"6f022ed2-a6a9-4feb-960e-ccabecc8152a","year":2020},"citing_paper":{"arxiv_id":"2502.06664","last_updated":"2025-02-24T10:07:54Z","snapshot_observed_at":"2026-08-08T14:41:57.380685Z","submitted_at":"2025-02-10T16:51:11Z","title":"Evaluation of Deep Audio Representations for Hearables","version":2},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-08T14:47:07.861060Z"},"links":{"citing_paper":"/paper/2502.06664"},"observation_digest":"sha256:60f206a72146a214d5fc89d5059fc8c354fd6c5b5d88e30667856e4bf49d2076","observation_id":"d8d32833-2724-4be7-8f0c-3263a0e2b8bf","resolution":{"observed_at":"2026-08-08T14:47:08.862024Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T14:47:08.841249Z","title":"Speech en- hancement for hearing-impaired listeners using deep neural networks with auditory-model based features,","venue":null,"work_id":"2fbd10b1-9925-4030-88cd-129372eab15e","year":2016},"citing_paper":{"arxiv_id":"2502.06664","last_updated":"2025-02-24T10:07:54Z","snapshot_observed_at":"2026-08-08T14:41:57.380685Z","submitted_at":"2025-02-10T16:51:11Z","title":"Evaluation of Deep Audio Representations for Hearables","version":2},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-08T14:47:07.866309Z"},"links":{"citing_paper":"/paper/2502.06664"},"observation_digest":"sha256:0cb1d7da24259a3cf35bc42fea5ee3787e5b4402edf22d45bc607ec5a579a5c3","observation_id":"f3f0768c-e44d-469b-9569-81173ce224a3","resolution":{"observed_at":"2026-08-08T14:47:08.846814Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T14:47:08.824654Z","title":"A deep learning based segregation algorithm to increase speech intelligibility for hearing- impaired listeners in reverberant-noisy conditions,","venue":null,"work_id":"a73a8014-7a2a-40bf-8dec-df72268686fd","year":2018},"citing_paper":{"arxiv_id":"2502.06664","last_updated":"2025-02-24T10:07:54Z","snapshot_observed_at":"2026-08-08T14:41:57.380685Z","submitted_at":"2025-02-10T16:51:11Z","title":"Evaluation of Deep Audio Representations for Hearables","version":2},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-08T14:47:07.870790Z"},"links":{"citing_paper":"/paper/2502.06664"},"observation_digest":"sha256:1e98d990226a1a351d9e139e2a697bf5a311f8bb7d118b1ddb94f321edbb0a52","observation_id":"656cb9f6-0cb0-4957-8af6-e82cdc535229","resolution":{"observed_at":"2026-08-08T14:47:08.829702Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T14:47:08.809936Z","title":"An effectively causal deep learning algorithm to increase intelligibility in untrained noises for hearing-impaired listeners,","venue":null,"work_id":"9954c145-ecb6-46fc-99bd-d205ea896042","year":2021},"citing_paper":{"arxiv_id":"2502.06664","last_updated":"2025-02-24T10:07:54Z","snapshot_observed_at":"2026-08-08T14:41:57.380685Z","submitted_at":"2025-02-10T16:51:11Z","title":"Evaluation of Deep Audio Representations for Hearables","version":2},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-08T14:47:07.875052Z"},"links":{"citing_paper":"/paper/2502.06664"},"observation_digest":"sha256:c325c8c56a256ae316dba01e67e1b55eda517a55e149cbd38882712146109244","observation_id":"58cea415-be84-4440-bf3c-b841a426b359","resolution":{"observed_at":"2026-08-08T14:47:08.814769Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T14:47:08.795160Z","title":"Creating clarity in noisy environments by using deep learning in hearing aids,","venue":null,"work_id":"7a45fa87-f641-41c9-a868-d71816dd7980","year":2021},"citing_paper":{"arxiv_id":"2502.06664","last_updated":"2025-02-24T10:07:54Z","snapshot_observed_at":"2026-08-08T14:41:57.380685Z","submitted_at":"2025-02-10T16:51:11Z","title":"Evaluation of Deep Audio Representations for Hearables","version":2},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-08T14:47:07.879367Z"},"links":{"citing_paper":"/paper/2502.06664"},"observation_digest":"sha256:dc52b84aa598f0f8f034fea668de56c7edb47a48b18130c8feeae74ab71955a5","observation_id":"a75e408a-0b8c-48e8-84ff-70ad9ebb56ca","resolution":{"observed_at":"2026-08-08T14:47:08.800028Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T14:47:08.779683Z","title":"Audio self-supervised learning: A survey,","venue":null,"work_id":"72afcd69-4128-4439-ada7-2de3b7f987b9","year":2022},"citing_paper":{"arxiv_id":"2502.06664","last_updated":"2025-02-24T10:07:54Z","snapshot_observed_at":"2026-08-08T14:41:57.380685Z","submitted_at":"2025-02-10T16:51:11Z","title":"Evaluation of Deep Audio Representations for Hearables","version":2},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-08T14:47:07.883644Z"},"links":{"citing_paper":"/paper/2502.06664"},"observation_digest":"sha256:64139e9039820251e3b6f907072f278db447e9e255569d511b059994d28064bb","observation_id":"3a34221f-396e-4b92-8160-c66c7dd8ac87","resolution":{"observed_at":"2026-08-08T14:47:08.784631Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T14:47:08.763430Z","title":"Restoring speech intelligibility for hearing aid users with deep learn- ing,","venue":null,"work_id":"dbc915ab-c907-4f65-b8ee-ee9189abac1b","year":2023},"citing_paper":{"arxiv_id":"2502.06664","last_updated":"2025-02-24T10:07:54Z","snapshot_observed_at":"2026-08-08T14:41:57.380685Z","submitted_at":"2025-02-10T16:51:11Z","title":"Evaluation of Deep Audio Representations for Hearables","version":2},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-08T14:47:07.887923Z"},"links":{"citing_paper":"/paper/2502.06664"},"observation_digest":"sha256:89db5ddfc5b16bd606d38e048038f99574c3e51305e8a8567cf43c7a90e714f7","observation_id":"94aecc16-9ef4-440d-a189-b1bbc22ee8a9","resolution":{"observed_at":"2026-08-08T14:47:08.768694Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T14:47:07.892188Z","title":"Towards learning a universal non- semantic representation of speech,","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2502.06664","last_updated":"2025-02-24T10:07:54Z","snapshot_observed_at":"2026-08-08T14:41:57.380685Z","submitted_at":"2025-02-10T16:51:11Z","title":"Evaluation of Deep Audio Representations for Hearables","version":2},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-08T14:47:07.892188Z"},"links":{"citing_paper":"/paper/2502.06664"},"observation_digest":"sha256:35f9196e4614eb5318e32092b6f865391f1c9b99ffb61d87853737aa7c2df70b","observation_id":"59cb5849-b5da-470f-abfa-eb311fbd7e55","resolution":{"observed_at":"2026-08-08T14:47:07.892188Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T14:47:08.738689Z","title":"Lebench- mark: A reproducible framework for assessing self-supervised represen- tation learning from speech,","venue":null,"work_id":"a25faf06-acce-44de-8b04-395289f31711","year":2021},"citing_paper":{"arxiv_id":"2502.06664","last_updated":"2025-02-24T10:07:54Z","snapshot_observed_at":"2026-08-08T14:41:57.380685Z","submitted_at":"2025-02-10T16:51:11Z","title":"Evaluation of Deep Audio Representations for Hearables","version":2},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-08T14:47:07.896564Z"},"links":{"citing_paper":"/paper/2502.06664"},"observation_digest":"sha256:61fd74208ad59a87a16f52884cdba639f124ea88b9833008d633fb748a1689c2","observation_id":"3fce7339-e3ed-4c88-bdcd-27f5c5bb74ce","resolution":{"observed_at":"2026-08-08T14:47:08.743558Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T14:47:08.723748Z","title":"Superb: Speech processing universal performance benchmark,","venue":null,"work_id":"b8524d1a-05fe-40ce-9056-b9f53534ae0b","year":null},"citing_paper":{"arxiv_id":"2502.06664","last_updated":"2025-02-24T10:07:54Z","snapshot_observed_at":"2026-08-08T14:41:57.380685Z","submitted_at":"2025-02-10T16:51:11Z","title":"Evaluation of Deep Audio Representations for Hearables","version":2},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-08T14:47:07.900688Z"},"links":{"citing_paper":"/paper/2502.06664"},"observation_digest":"sha256:e6ae8d70a20953edca048b8e8dfcf0fbd26c37af8a67cd081ecfc8a9ca2b2e41","observation_id":"9e69218f-9667-458e-a338-3b0fd3b297b5","resolution":{"observed_at":"2026-08-08T14:47:08.728542Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T14:47:08.649859Z","title":"Towards learning universal audio representations,","venue":null,"work_id":"f5481222-7a5c-4679-95ee-f583ea7acd9b","year":2022},"citing_paper":{"arxiv_id":"2502.06664","last_updated":"2025-02-24T10:07:54Z","snapshot_observed_at":"2026-08-08T14:41:57.380685Z","submitted_at":"2025-02-10T16:51:11Z","title":"Evaluation of Deep Audio Representations for Hearables","version":2},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-08T14:47:07.909178Z"},"links":{"citing_paper":"/paper/2502.06664"},"observation_digest":"sha256:2cbffd6789d3da1f362aebdca4289aa120bcc35f767b707af90aa7b901bed85d","observation_id":"5cbb0603-3997-425d-b1a1-2a123390fd67","resolution":{"observed_at":"2026-08-08T14:47:08.664027Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T14:47:07.913428Z","title":"Hear: Holistic evaluation of audio representations,","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2502.06664","last_updated":"2025-02-24T10:07:54Z","snapshot_observed_at":"2026-08-08T14:41:57.380685Z","submitted_at":"2025-02-10T16:51:11Z","title":"Evaluation of Deep Audio Representations for Hearables","version":2},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-08T14:47:07.913428Z"},"links":{"citing_paper":"/paper/2502.06664"},"observation_digest":"sha256:ecf3b27ac825a0094badd94f673719a471cd7c020ee995d8ff7bf672836abfdb","observation_id":"d69b4a8e-3950-4884-b6dd-8aa18a408b79","resolution":{"observed_at":"2026-08-08T14:47:07.913428Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T14:47:08.560291Z","title":"Decorrelating feature spaces for learning general-purpose audio representations,","venue":null,"work_id":"f6fe4d08-e2a0-4747-9f1c-45d270110979","year":2022},"citing_paper":{"arxiv_id":"2502.06664","last_updated":"2025-02-24T10:07:54Z","snapshot_observed_at":"2026-08-08T14:41:57.380685Z","submitted_at":"2025-02-10T16:51:11Z","title":"Evaluation of Deep Audio Representations for Hearables","version":2},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-08T14:47:07.917846Z"},"links":{"citing_paper":"/paper/2502.06664"},"observation_digest":"sha256:e43c383799a87d9e7bdfb1c9c334ed0a06abd9eb89cc758b119f70bf62170c66","observation_id":"c2cc9df0-0183-4736-9fe4-806966e77ed3","resolution":{"observed_at":"2026-08-08T14:47:08.619070Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2405.00934","last_updated":"2024-05-02T01:24:53Z","snapshot_observed_at":"2026-07-30T12:15:25.209790Z","submitted_at":"2024-05-02T01:24:53Z","title":"Benchmarking Representations for Speech, Music, and Acoustic Events","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2405.00934","snapshot_observed_at":"2026-08-08T14:47:07.922634Z","title":"Benchmarking representations for speech, music, and acoustic events,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2502.06664","last_updated":"2025-02-24T10:07:54Z","snapshot_observed_at":"2026-08-08T14:41:57.380685Z","submitted_at":"2025-02-10T16:51:11Z","title":"Evaluation of Deep Audio Representations for Hearables","version":2},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-08T14:47:07.922634Z"},"links":{"cited_paper":"/paper/2405.00934","citing_paper":"/paper/2502.06664"},"observation_digest":"sha256:7794362864f3c4324a32907921c513a3d23425af87401bd3f4144266b7555c04","observation_id":"351f48fd-d978-4780-bccc-0683e9b0a9e6","resolution":{"observed_at":"2026-08-08T14:47:07.922634Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"document/7486010","doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T14:47:08.343400Z","title":"Estimation of Room Acoustic Parameters: The ACE Challenge,","venue":null,"work_id":"9439d17b-9e89-4d00-a3b0-94e90b649ab3","year":2016},"citing_paper":{"arxiv_id":"2502.06664","last_updated":"2025-02-24T10:07:54Z","snapshot_observed_at":"2026-08-08T14:41:57.380685Z","submitted_at":"2025-02-10T16:51:11Z","title":"Evaluation of Deep Audio Representations for Hearables","version":2},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-08T14:47:07.927311Z"},"links":{"citing_paper":"/paper/2502.06664"},"observation_digest":"sha256:5a8eddcb0744095af11209ccff02e854314ac984628e0396220560ed97131e79","observation_id":"dbbc6c19-0531-485f-b36c-8eab7cdb5b92","resolution":{"observed_at":"2026-08-08T14:47:08.355009Z","resolver_source":"raw_fallback","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T14:47:08.539510Z","title":"Reverberation effects on source localization and beamforming for hearing aid applications,","venue":null,"work_id":"e7d7ebd4-92dc-448b-946d-9a226e682960","year":2018},"citing_paper":{"arxiv_id":"2502.06664","last_updated":"2025-02-24T10:07:54Z","snapshot_observed_at":"2026-08-08T14:41:57.380685Z","submitted_at":"2025-02-10T16:51:11Z","title":"Evaluation of Deep Audio Representations for Hearables","version":2},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-08T14:47:07.931870Z"},"links":{"citing_paper":"/paper/2502.06664"},"observation_digest":"sha256:076e2d96efe86f200049a9b5d104f389e3ad6e7cf6113f300fb9c529d96567ff","observation_id":"9dd7637a-93aa-4fac-9988-9e5ca377b293","resolution":{"observed_at":"2026-08-08T14:47:08.544109Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T14:47:08.523853Z","title":"Effects of room reflectance and background noise on perceived auditory distance,","venue":null,"work_id":"1fe975ab-987a-4c31-a34d-783bcbb6cfbe","year":1989},"citing_paper":{"arxiv_id":"2502.06664","last_updated":"2025-02-24T10:07:54Z","snapshot_observed_at":"2026-08-08T14:41:57.380685Z","submitted_at":"2025-02-10T16:51:11Z","title":"Evaluation of Deep Audio Representations for Hearables","version":2},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-08T14:47:07.936084Z"},"links":{"citing_paper":"/paper/2502.06664"},"observation_digest":"sha256:cbb6eec45afd9693b2c571cc524f21600ca4fa4cf6b58fd61187a4e486b3ccc3","observation_id":"0c1903d0-52ad-49db-a8f5-1e99c9a59c3c","resolution":{"observed_at":"2026-08-08T14:47:08.529646Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T14:47:08.508533Z","title":"Sound localization: Effects of reverberation time, speaker array, stimulus frequency, and stimulus rise/decay,","venue":null,"work_id":"c7ae6245-a327-4606-9c82-ce5962662969","year":1993},"citing_paper":{"arxiv_id":"2502.06664","last_updated":"2025-02-24T10:07:54Z","snapshot_observed_at":"2026-08-08T14:41:57.380685Z","submitted_at":"2025-02-10T16:51:11Z","title":"Evaluation of Deep Audio Representations for Hearables","version":2},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-08T14:47:07.940306Z"},"links":{"citing_paper":"/paper/2502.06664"},"observation_digest":"sha256:02c33e34578e07f7df5089c3853e09ee813e9ab825fcb960bffff34195886e01","observation_id":"193ea3ec-9d38-48f9-a06c-374a7d764dc5","resolution":{"observed_at":"2026-08-08T14:47:08.513167Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T14:47:08.492473Z","title":"Effects of reverberation and noise on speech intelligibility in normal-hearing and aided hearing-impaired listeners,","venue":null,"work_id":"5194e724-3ba6-49cc-8189-67ad8393b3d1","year":2018},"citing_paper":{"arxiv_id":"2502.06664","last_updated":"2025-02-24T10:07:54Z","snapshot_observed_at":"2026-08-08T14:41:57.380685Z","submitted_at":"2025-02-10T16:51:11Z","title":"Evaluation of Deep Audio Representations for Hearables","version":2},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-08T14:47:07.944604Z"},"links":{"citing_paper":"/paper/2502.06664"},"observation_digest":"sha256:9508654bafef6e3a84d53a4b9790b92b9332083d4ee652a6635916344cf7f708","observation_id":"5ffed7b1-3db3-493e-9729-69c4ff6e995e","resolution":{"observed_at":"2026-08-08T14:47:08.497358Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2311.01964","last_updated":"2023-11-03T14:59:54Z","snapshot_observed_at":"2026-08-06T10:56:05.075839Z","submitted_at":"2023-11-03T14:59:54Z","title":"Don't Make Your LLM an Evaluation Benchmark Cheater","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2311.01964","snapshot_observed_at":"2026-08-08T14:47:07.948894Z","title":"Don’t make your llm an evaluation benchmark cheater,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2502.06664","last_updated":"2025-02-24T10:07:54Z","snapshot_observed_at":"2026-08-08T14:41:57.380685Z","submitted_at":"2025-02-10T16:51:11Z","title":"Evaluation of Deep Audio Representations for Hearables","version":2},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-08-08T14:47:07.948894Z"},"links":{"cited_paper":"/paper/2311.01964","citing_paper":"/paper/2502.06664"},"observation_digest":"sha256:fb858f8bc0f8c1749729ebf2444b9ccd711d646e97c056c061279f4cfcc8a409","observation_id":"da61f099-43c0-4391-b0e5-9c8fdf2484e3","resolution":{"observed_at":"2026-08-08T14:47:07.948894Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T14:47:08.475893Z","title":"Tut database for acoustic scene classification and sound event detection,","venue":null,"work_id":"e5fb2a06-98ef-46fe-bbce-a6a70e65359f","year":2016},"citing_paper":{"arxiv_id":"2502.06664","last_updated":"2025-02-24T10:07:54Z","snapshot_observed_at":"2026-08-08T14:41:57.380685Z","submitted_at":"2025-02-10T16:51:11Z","title":"Evaluation of Deep Audio Representations for Hearables","version":2},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-08-08T14:47:07.953563Z"},"links":{"citing_paper":"/paper/2502.06664"},"observation_digest":"sha256:d95b71752c1df8743d0e857296a2771ea5e35f1bb2ac26541c94bb6f9eedf4b7","observation_id":"63c0c753-8d14-4c60-869c-8631de2fe5a1","resolution":{"observed_at":"2026-08-08T14:47:08.480367Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T14:47:07.958128Z","title":"Libricount, a dataset for speaker count estimation,","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2502.06664","last_updated":"2025-02-24T10:07:54Z","snapshot_observed_at":"2026-08-08T14:41:57.380685Z","submitted_at":"2025-02-10T16:51:11Z","title":"Evaluation of Deep Audio Representations for Hearables","version":2},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-08-08T14:47:07.958128Z"},"links":{"citing_paper":"/paper/2502.06664"},"observation_digest":"sha256:22499cf9f4992045be1781886130877e1436cd40e395ab92dd96f1c72e1de22c","observation_id":"a619abc2-d7e2-4039-b0d6-07dca95fd37b","resolution":{"observed_at":"2026-08-08T14:47:07.958128Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T14:47:08.451018Z","title":"Librispeech: An ASR corpus based on public domain audio books,","venue":null,"work_id":"34059c55-1898-4f3c-844a-f89993dcc6f1","year":2015},"citing_paper":{"arxiv_id":"2502.06664","last_updated":"2025-02-24T10:07:54Z","snapshot_observed_at":"2026-08-08T14:41:57.380685Z","submitted_at":"2025-02-10T16:51:11Z","title":"Evaluation of Deep Audio Representations for Hearables","version":2},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-08-08T14:47:07.962630Z"},"links":{"citing_paper":"/paper/2502.06664"},"observation_digest":"sha256:63539d48c3ae92c585a00ce70c6fac5864398aa43b14a8e34864d05c8d0b98f4","observation_id":"04eb0347-ce4d-4a45-bc65-750923d248f2","resolution":{"observed_at":"2026-08-08T14:47:08.456289Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T14:47:07.966826Z","title":"Audio set: An ontology and human- labeled dataset for audio events,","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2502.06664","last_updated":"2025-02-24T10:07:54Z","snapshot_observed_at":"2026-08-08T14:41:57.380685Z","submitted_at":"2025-02-10T16:51:11Z","title":"Evaluation of Deep Audio Representations for Hearables","version":2},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-08-08T14:47:07.966826Z"},"links":{"citing_paper":"/paper/2502.06664"},"observation_digest":"sha256:2049625b70d34bc086730c75a5f2faf7d87e5e80d180e6946d1cd841c48608c4","observation_id":"49ba8711-b16b-4477-87b6-976fc8a06409","resolution":{"observed_at":"2026-08-08T14:47:07.966826Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T14:47:08.425489Z","title":"ESC: Dataset for environmental sound classification,","venue":null,"work_id":"45226229-ba6a-4718-938d-e5a428d82fdb","year":2015},"citing_paper":{"arxiv_id":"2502.06664","last_updated":"2025-02-24T10:07:54Z","snapshot_observed_at":"2026-08-08T14:41:57.380685Z","submitted_at":"2025-02-10T16:51:11Z","title":"Evaluation of Deep Audio Representations for Hearables","version":2},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-08-08T14:47:07.971192Z"},"links":{"citing_paper":"/paper/2502.06664"},"observation_digest":"sha256:ddcf70cea9de96db8a648794a511da7d093c81a164095e1e26b3f53f5bd8110a","observation_id":"5114e49c-5235-4498-8a70-cda1dcddc45c","resolution":{"observed_at":"2026-08-08T14:47:08.430750Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T14:47:07.975506Z","title":"wav2vec 2.0: A framework for self-supervised learning of speech representations,","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2502.06664","last_updated":"2025-02-24T10:07:54Z","snapshot_observed_at":"2026-08-08T14:41:57.380685Z","submitted_at":"2025-02-10T16:51:11Z","title":"Evaluation of Deep Audio Representations for Hearables","version":2},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-08-08T14:47:07.975506Z"},"links":{"citing_paper":"/paper/2502.06664"},"observation_digest":"sha256:5d61f5970581bb57d4bcc480e190c512ad13e898ecab6305556b8f1a88357d61","observation_id":"91661b0a-5914-49bc-b4df-b42075f6955e","resolution":{"observed_at":"2026-08-08T14:47:07.975506Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T14:47:08.400501Z","title":"HuBERT: Self-Supervised Speech Representation Learn- ing by Masked Prediction of Hidden Units,","venue":null,"work_id":"7fd9d619-ba6a-470c-b875-1ee3a3b7c4d3","year":2021},"citing_paper":{"arxiv_id":"2502.06664","last_updated":"2025-02-24T10:07:54Z","snapshot_observed_at":"2026-08-08T14:41:57.380685Z","submitted_at":"2025-02-10T16:51:11Z","title":"Evaluation of Deep Audio Representations for Hearables","version":2},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-08-08T14:47:07.980282Z"},"links":{"citing_paper":"/paper/2502.06664"},"observation_digest":"sha256:b0c48e96e2663ce345acae24f354d70edf586e5bd847a0aaad5223ddf39edc1c","observation_id":"529fd8be-d432-4950-86e1-c6c24dd2e48a","resolution":{"observed_at":"2026-08-08T14:47:08.404983Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T14:47:07.984844Z","title":"Wavlm: Large-scale self-supervised pre- training for full stack speech processing,","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2502.06664","last_updated":"2025-02-24T10:07:54Z","snapshot_observed_at":"2026-08-08T14:41:57.380685Z","submitted_at":"2025-02-10T16:51:11Z","title":"Evaluation of Deep Audio Representations for Hearables","version":2},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-08-08T14:47:07.984844Z"},"links":{"citing_paper":"/paper/2502.06664"},"observation_digest":"sha256:e7a90df450ab12fb428934231c9f5fd157184bc99ffeb36a319e1e9ef7d19e85","observation_id":"83f95f6a-ab70-4ee5-974c-ee653cdfd0fe","resolution":{"observed_at":"2026-08-08T14:47:07.984844Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2212.09058","last_updated":"2022-12-18T10:41:55Z","snapshot_observed_at":"2026-08-07T22:06:19.360625Z","submitted_at":"2022-12-18T10:41:55Z","title":"BEATs: Audio Pre-Training with Acoustic Tokenizers","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2212.09058","snapshot_observed_at":"2026-08-08T14:47:07.989640Z","title":"Beats: Audio pre-training with acoustic tokenizers,","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2502.06664","last_updated":"2025-02-24T10:07:54Z","snapshot_observed_at":"2026-08-08T14:41:57.380685Z","submitted_at":"2025-02-10T16:51:11Z","title":"Evaluation of Deep Audio Representations for Hearables","version":2},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-08-08T14:47:07.989640Z"},"links":{"cited_paper":"/paper/2212.09058","citing_paper":"/paper/2502.06664"},"observation_digest":"sha256:dc215f24e59cc221b50a9500e88a75fc65e2644b4ce82b4c081f264a634f608b","observation_id":"9ba18c47-ad51-489b-a2ad-5cbd56f2e8e3","resolution":{"observed_at":"2026-08-08T14:47:07.989640Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1904.05862","last_updated":"2019-09-11T08:19:49Z","snapshot_observed_at":"2026-08-06T05:33:37.746688Z","submitted_at":"2019-04-11T17:29:30Z","title":"wav2vec: Unsupervised Pre-training for Speech Recognition","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1904.05862","snapshot_observed_at":"2026-08-08T14:47:07.994420Z","title":"wav2vec: Unsupervised pre-training for speech recognition,","venue":null,"work_id":null,"year":1904},"citing_paper":{"arxiv_id":"2502.06664","last_updated":"2025-02-24T10:07:54Z","snapshot_observed_at":"2026-08-08T14:41:57.380685Z","submitted_at":"2025-02-10T16:51:11Z","title":"Evaluation of Deep Audio Representations for Hearables","version":2},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-08-08T14:47:07.994420Z"},"links":{"cited_paper":"/paper/1904.05862","citing_paper":"/paper/2502.06664"},"observation_digest":"sha256:ef0b78db30e1170fd15a13885a951391ee5f2b562dbc92b89ac162775b7529d5","observation_id":"3e4e6b38-1910-4a57-a1ed-bb0b929aa685","resolution":{"observed_at":"2026-08-08T14:47:07.994420Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1810.04805","last_updated":"2019-05-24T20:37:26Z","snapshot_observed_at":"2026-07-30T09:12:38.100527Z","submitted_at":"2018-10-11T00:50:01Z","title":"BERT: Pre-training of Deep Bidirectional Transformers for Language Understanding","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1810.04805","snapshot_observed_at":"2026-08-08T14:47:07.999570Z","title":"Bert: Pre-training of deep bidirectional transformers for language understanding,","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2502.06664","last_updated":"2025-02-24T10:07:54Z","snapshot_observed_at":"2026-08-08T14:41:57.380685Z","submitted_at":"2025-02-10T16:51:11Z","title":"Evaluation of Deep Audio Representations for Hearables","version":2},"reference_index":36,"source":"pdf_text","source_observed_at":"2026-08-08T14:47:07.999570Z"},"links":{"cited_paper":"/paper/1810.04805","citing_paper":"/paper/2502.06664"},"observation_digest":"sha256:baa0fe6f33b455cd0255b83ccc8430ed93cb77f3414d0d43bc7421d294b3abeb","observation_id":"e289f3b5-e13e-4ee9-9c6e-94182ae90385","resolution":{"observed_at":"2026-08-08T14:47:07.999570Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2106.06909","last_updated":"2021-06-13T04:09:16Z","snapshot_observed_at":"2026-08-09T08:32:43.969496Z","submitted_at":"2021-06-13T04:09:16Z","title":"GigaSpeech: An Evolving, Multi-domain ASR Corpus with 10,000 Hours of Transcribed Audio","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2106.06909","snapshot_observed_at":"2026-08-08T14:47:08.004692Z","title":"Gigaspeech: An evolving, multi- domain asr corpus with 10,000 hours of transcribed audio,","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2502.06664","last_updated":"2025-02-24T10:07:54Z","snapshot_observed_at":"2026-08-08T14:41:57.380685Z","submitted_at":"2025-02-10T16:51:11Z","title":"Evaluation of Deep Audio Representations for Hearables","version":2},"reference_index":37,"source":"pdf_text","source_observed_at":"2026-08-08T14:47:08.004692Z"},"links":{"cited_paper":"/paper/2106.06909","citing_paper":"/paper/2502.06664"},"observation_digest":"sha256:a091c62da0157a10381767f765e43160659cf6dad61b10257374605479494826","observation_id":"dc0f1a0c-da2c-42f6-9c52-6db19d93f9c0","resolution":{"observed_at":"2026-08-08T14:47:08.004692Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2101.00390","last_updated":"2021-07-27T04:04:57Z","snapshot_observed_at":"2026-08-09T19:09:23.880235Z","submitted_at":"2021-01-02T07:24:21Z","title":"VoxPopuli: A Large-Scale Multilingual Speech Corpus for Representation Learning, Semi-Supervised Learning and Interpretation","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2101.00390","snapshot_observed_at":"2026-08-08T14:47:08.009413Z","title":"V oxpopuli: A large-scale multilingual speech corpus for representation learning, semi-supervised learning and interpretation,","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2502.06664","last_updated":"2025-02-24T10:07:54Z","snapshot_observed_at":"2026-08-08T14:41:57.380685Z","submitted_at":"2025-02-10T16:51:11Z","title":"Evaluation of Deep Audio Representations for Hearables","version":2},"reference_index":38,"source":"pdf_text","source_observed_at":"2026-08-08T14:47:08.009413Z"},"links":{"cited_paper":"/paper/2101.00390","citing_paper":"/paper/2502.06664"},"observation_digest":"sha256:677f00a42f406b8206754c91b47685572b54d7d8ec4502c06d173e19831f6480","observation_id":"b8dc698b-945b-4e0b-bc4d-6653c2e744d6","resolution":{"observed_at":"2026-08-08T14:47:08.009413Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T14:47:08.014339Z","title":"Emerging properties in self-supervised vision transformers,","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2502.06664","last_updated":"2025-02-24T10:07:54Z","snapshot_observed_at":"2026-08-08T14:41:57.380685Z","submitted_at":"2025-02-10T16:51:11Z","title":"Evaluation of Deep Audio Representations for Hearables","version":2},"reference_index":39,"source":"pdf_text","source_observed_at":"2026-08-08T14:47:08.014339Z"},"links":{"citing_paper":"/paper/2502.06664"},"observation_digest":"sha256:1aea3eebe34a694dc40fa6b2458983478059208ea1c482c4a0fa597f06413e2b","observation_id":"b1312020-5409-4e47-924f-0851590d980f","resolution":{"observed_at":"2026-08-08T14:47:08.014339Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T14:47:08.693878Z","title":"3161–3165","venue":null,"work_id":"7b3be7ce-5433-499c-b86f-977729ba1d7b","year":2021},"citing_paper":{"arxiv_id":"2502.06664","last_updated":"2025-02-24T10:07:54Z","snapshot_observed_at":"2026-08-08T14:41:57.380685Z","submitted_at":"2025-02-10T16:51:11Z","title":"Evaluation of Deep Audio Representations for Hearables","version":2},"reference_index":2021,"source":"pdf_text","source_observed_at":"2026-08-08T14:47:07.905040Z"},"links":{"citing_paper":"/paper/2502.06664"},"observation_digest":"sha256:6a9886d8a4e4d2a605f2b454a078bdaefe6bd49c3f7468ec9f53ef5c9090b430","observation_id":"9aedf2d6-e40c-4d9a-ba9d-3a8679eb6712","resolution":{"observed_at":"2026-08-08T14:47:08.710375Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}}],"paper":{"arxiv_id":"2502.06664","last_updated":"2025-02-24T10:07:54Z","latest_version":2,"primary_category":"cs.SD","snapshot_observed_at":"2026-08-08T14:41:57.380685Z","submitted_at":"2025-02-10T16:51:11Z","title":"Evaluation of Deep Audio Representations for Hearables"},"reference_resolution":{"displayed":40,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":15,"verified_exact":1,"verified_fuzzy":24},"total_outbound_references":40},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"thesis":"As of 10 August 2026, this Paper Citation Record lists 40 of 40 outbound references and 0 inbound Pith citation observations for arXiv:2502.06664."}