{"as_of":"2026-08-23T22:05:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:69d84cbfd8f1e57ab0aa85b150af69eafcc9470af961e68e5b523420caae1b37","coverage":[{"denominator":42,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":42,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-07T14:29:14.171935Z","state":"measured"},{"denominator":44,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":44,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-23T06:30:58.430688+00:00","state":"measured"},{"denominator":2,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":2,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-07T14:29:08.044481Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"arxiv_reference","source_observed_at":"2026-06-28T17:12:25.097476Z","state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2505.18860","last_updated":"2025-05-24T20:40:51Z","snapshot_observed_at":"2026-08-17T09:59:49.571743Z","submitted_at":"2025-05-24T20:40:51Z","title":"Context-Driven Dynamic Pruning for Large Speech Foundation Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2505.18860","snapshot_observed_at":"2026-08-07T14:29:08.044481Z","title":"Related Works Pruning techniques for speech processing models have been extensively studied [11, 14, 26, 27]","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2505.18860","last_updated":"2025-05-24T20:40:51Z","snapshot_observed_at":"2026-08-17T09:59:49.571743Z","submitted_at":"2025-05-24T20:40:51Z","title":"Context-Driven Dynamic Pruning for Large Speech Foundation Models","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-07T14:29:08.044481Z"},"links":{"cited_paper":"/paper/2505.18860","citing_paper":"/paper/2505.18860"},"observation_digest":"sha256:fae8c6639c12c177123791e56ec3ca516f804e598e5bcaa072dcfb4b937ad15c","observation_id":"f432fb50-9ff4-4e00-b822-9535741ff7ae","resolution":{"observed_at":"2026-08-07T14:29:08.044481Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2505.18860","last_updated":"2025-05-24T20:40:51Z","snapshot_observed_at":"2026-08-17T09:59:49.571743Z","submitted_at":"2025-05-24T20:40:51Z","title":"Context-Driven Dynamic Pruning for Large Speech Foundation Models","version":1},"cited_work":{"arxiv_id":"2505.18860","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2505.18860","snapshot_observed_at":"2026-06-28T17:12:25.097476Z","title":"arXiv preprint arXiv:2505.18860 , year=","venue":null,"work_id":"3010bfae-e776-4a66-a4a2-052ea2d169f8","year":null},"citing_paper":{"arxiv_id":"2606.01483","last_updated":"2026-05-31T22:54:57Z","snapshot_observed_at":"2026-08-14T06:27:31.699966Z","submitted_at":"2026-05-31T22:54:57Z","title":"MURMUR: An Efficient Inference System for Long-Form ASR","version":1},"reference_index":31,"source":"arxiv_source","source_observed_at":"2026-06-28T17:06:02.978205Z"},"links":{"cited_paper":"/paper/2505.18860","citing_paper":"/paper/2606.01483"},"observation_digest":"sha256:3ac66bcf8bd1de4b46e0b9590a9927f8f12fc8b7f52e2a8f9a9a19ec389bb4a4","observation_id":"baff783a-0c4c-41f5-ab30-3877d2cfc228","resolution":{"observed_at":"2026-06-28T17:12:25.099036Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}}],"links":{"evidence":"/evidence","html":"/paper/2505.18860/citation-record","integrity":"/paper/2505.18860/integrity","json":"/paper/2505.18860/citation-record.json","paper":"/paper/2505.18860"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:29:24.761820Z","title":"These speech foundation models demon- strate strong generalization ability and robustness across lan- guages [3], speakers, and acoustic conditions [1]","venue":null,"work_id":"55efe46b-13d8-4065-8de7-1ae31dd13960","year":null},"citing_paper":{"arxiv_id":"2505.18860","last_updated":"2025-05-24T20:40:51Z","snapshot_observed_at":"2026-08-17T09:59:49.571743Z","submitted_at":"2025-05-24T20:40:51Z","title":"Context-Driven Dynamic Pruning for Large Speech Foundation Models","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-07T14:29:07.916684Z"},"links":{"citing_paper":"/paper/2505.18860"},"observation_digest":"sha256:f71b8633c43060ce63f1da27558bbc005439e6b5d357444a49a60a3cf86e5c40","observation_id":"7b330159-6399-4c9e-9fca-7a73f88e2c7f","resolution":{"observed_at":"2026-08-07T14:29:24.918993Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2505.18860","last_updated":"2025-05-24T20:40:51Z","snapshot_observed_at":"2026-08-17T09:59:49.571743Z","submitted_at":"2025-05-24T20:40:51Z","title":"Context-Driven Dynamic Pruning for Large Speech Foundation Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2505.18860","snapshot_observed_at":"2026-08-07T14:29:08.044481Z","title":"Related Works Pruning techniques for speech processing models have been extensively studied [11, 14, 26, 27]","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2505.18860","last_updated":"2025-05-24T20:40:51Z","snapshot_observed_at":"2026-08-17T09:59:49.571743Z","submitted_at":"2025-05-24T20:40:51Z","title":"Context-Driven Dynamic Pruning for Large Speech Foundation Models","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-07T14:29:08.044481Z"},"links":{"cited_paper":"/paper/2505.18860","citing_paper":"/paper/2505.18860"},"observation_digest":"sha256:fae8c6639c12c177123791e56ec3ca516f804e598e5bcaa072dcfb4b937ad15c","observation_id":"f432fb50-9ff4-4e00-b822-9535741ff7ae","resolution":{"observed_at":"2026-08-07T14:29:08.044481Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:29:24.395725Z","title":"Local Gate Predictor In localGP, the pruning maskzis computed separately for each layer","venue":null,"work_id":"c47f0082-8733-4ed0-8b58-adae55a3fbdf","year":null},"citing_paper":{"arxiv_id":"2505.18860","last_updated":"2025-05-24T20:40:51Z","snapshot_observed_at":"2026-08-17T09:59:49.571743Z","submitted_at":"2025-05-24T20:40:51Z","title":"Context-Driven Dynamic Pruning for Large Speech Foundation Models","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-07T14:29:08.165498Z"},"links":{"citing_paper":"/paper/2505.18860"},"observation_digest":"sha256:09e1d0d56c6b37ab7a1f1594c4c3dbbeb36aa6e549361b397e36c63579edc29b","observation_id":"1017a677-2ca2-4d9e-8aff-3a6c82708e0f","resolution":{"observed_at":"2026-08-07T14:29:24.553447Z","resolver_source":"raw_fallback","status":"malformed_identifier"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:29:24.043797Z","title":null,"venue":null,"work_id":"f77011f8-1f8a-45de-9ec0-85c890793391","year":null},"citing_paper":{"arxiv_id":"2505.18860","last_updated":"2025-05-24T20:40:51Z","snapshot_observed_at":"2026-08-17T09:59:49.571743Z","submitted_at":"2025-05-24T20:40:51Z","title":"Context-Driven Dynamic Pruning for Large Speech Foundation Models","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-07T14:29:08.324003Z"},"links":{"citing_paper":"/paper/2505.18860"},"observation_digest":"sha256:c349136fc986e54a8bcda11a26230f68ce99297459c9d84e0a85a7032ed92367","observation_id":"db3c2d39-ef0d-4941-8937-509d27c5e207","resolution":{"observed_at":"2026-08-07T14:29:24.225442Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:29:23.397288Z","title":null,"venue":null,"work_id":"5c578031-3065-438f-9320-04e697b4ff2d","year":null},"citing_paper":{"arxiv_id":"2505.18860","last_updated":"2025-05-24T20:40:51Z","snapshot_observed_at":"2026-08-17T09:59:49.571743Z","submitted_at":"2025-05-24T20:40:51Z","title":"Context-Driven Dynamic Pruning for Large Speech Foundation Models","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-07T14:29:08.682694Z"},"links":{"citing_paper":"/paper/2505.18860"},"observation_digest":"sha256:acf64a3f314c5f313daa7dfd01f139eacde5b7e840594888bb392db22d0749a2","observation_id":"593d94ee-ae03-4819-8a87-84fdeadbe2ad","resolution":{"observed_at":"2026-08-07T14:29:23.557920Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:29:08.820355Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2505.18860","last_updated":"2025-05-24T20:40:51Z","snapshot_observed_at":"2026-08-17T09:59:49.571743Z","submitted_at":"2025-05-24T20:40:51Z","title":"Context-Driven Dynamic Pruning for Large Speech Foundation Models","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-07T14:29:08.820355Z"},"links":{"citing_paper":"/paper/2505.18860"},"observation_digest":"sha256:25b158221e522e06438e15db7335ee12ee1db28d437162f3a20f31b0f2fcdc57","observation_id":"a53fe0bc-8679-44b7-8549-433b744c465a","resolution":{"observed_at":"2026-08-07T14:29:08.820355Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:29:22.173835Z","title":"Colld: Contrastive layer-to-layer distillation for compressing multilingual pre-trained speech encoders,","venue":null,"work_id":"6603063d-15da-4d61-9aa4-38c355a5bb2e","year":2024},"citing_paper":{"arxiv_id":"2505.18860","last_updated":"2025-05-24T20:40:51Z","snapshot_observed_at":"2026-08-17T09:59:49.571743Z","submitted_at":"2025-05-24T20:40:51Z","title":"Context-Driven Dynamic Pruning for Large Speech Foundation Models","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-07T14:29:09.860129Z"},"links":{"citing_paper":"/paper/2505.18860"},"observation_digest":"sha256:3bf22c87acace7d6ac4f15883b9f71ee47fec443d0ef36d21ae034d04bb64efe","observation_id":"ec257d9b-3e62-467a-92f0-f9dfce5d2a1c","resolution":{"observed_at":"2026-08-07T14:29:22.249161Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:29:23.719548Z","title":null,"venue":null,"work_id":"8a8f26fe-8b9e-4539-ab95-2c7a9eb6c2ce","year":2025},"citing_paper":{"arxiv_id":"2505.18860","last_updated":"2025-05-24T20:40:51Z","snapshot_observed_at":"2026-08-17T09:59:49.571743Z","submitted_at":"2025-05-24T20:40:51Z","title":"Context-Driven Dynamic Pruning for Large Speech Foundation Models","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-07T14:29:08.504355Z"},"links":{"citing_paper":"/paper/2505.18860"},"observation_digest":"sha256:1de1b31ef2309a0c4a3425634381ea55cb36fe67caac7a08cf938623919eab40","observation_id":"6e27afa5-9cf0-4c39-97b0-3cbd119c2240","resolution":{"observed_at":"2026-08-07T14:29:23.890200Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:29:08.962813Z","title":"Robust speech recognition via large-scale weak supervision,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.18860","last_updated":"2025-05-24T20:40:51Z","snapshot_observed_at":"2026-08-17T09:59:49.571743Z","submitted_at":"2025-05-24T20:40:51Z","title":"Context-Driven Dynamic Pruning for Large Speech Foundation Models","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-07T14:29:08.962813Z"},"links":{"citing_paper":"/paper/2505.18860"},"observation_digest":"sha256:0d3eb0553532730de9202377220df9109b6406e5e43ecfca79a08b17d4536d64","observation_id":"abcc7e10-178a-4ba5-9615-f7168bf823e8","resolution":{"observed_at":"2026-08-07T14:29:08.962813Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:29:23.099473Z","title":"Less is more: Accu- rate speech recognition & translation without web-scale data,","venue":null,"work_id":"01a08c59-104a-4246-b8ab-773969a52a94","year":2024},"citing_paper":{"arxiv_id":"2505.18860","last_updated":"2025-05-24T20:40:51Z","snapshot_observed_at":"2026-08-17T09:59:49.571743Z","submitted_at":"2025-05-24T20:40:51Z","title":"Context-Driven Dynamic Pruning for Large Speech Foundation Models","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-07T14:29:09.110260Z"},"links":{"citing_paper":"/paper/2505.18860"},"observation_digest":"sha256:1ceb4b0d734121be8d648b324550781db19e2c71de3da7686acb84a09c097d87","observation_id":"c8aefc18-9d3e-438a-8eb8-b55fc2f9360f","resolution":{"observed_at":"2026-08-07T14:29:23.229891Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2305.13516","last_updated":"2023-05-22T22:09:41Z","snapshot_observed_at":"2026-08-19T02:48:06.947821Z","submitted_at":"2023-05-22T22:09:41Z","title":"Scaling Speech Technology to 1,000+ Languages","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2305.13516","snapshot_observed_at":"2026-08-07T14:29:09.278802Z","title":"Scal- ing speech technology to 1,000+ languages,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.18860","last_updated":"2025-05-24T20:40:51Z","snapshot_observed_at":"2026-08-17T09:59:49.571743Z","submitted_at":"2025-05-24T20:40:51Z","title":"Context-Driven Dynamic Pruning for Large Speech Foundation Models","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-07T14:29:09.278802Z"},"links":{"cited_paper":"/paper/2305.13516","citing_paper":"/paper/2505.18860"},"observation_digest":"sha256:6b787e6ce682fe0e9dd8b13d34ca13d11c9b4ae554d5638f3befcb6ba20482f1","observation_id":"8cfc4100-3c36-4267-9218-487531fe4f54","resolution":{"observed_at":"2026-08-07T14:29:09.278802Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:29:22.822179Z","title":"Owsm v3.1: Better and faster open whisper-style speech models based on e-branchformer,","venue":null,"work_id":"2a1dbc65-e534-4256-8740-4de7dd79fd53","year":2024},"citing_paper":{"arxiv_id":"2505.18860","last_updated":"2025-05-24T20:40:51Z","snapshot_observed_at":"2026-08-17T09:59:49.571743Z","submitted_at":"2025-05-24T20:40:51Z","title":"Context-Driven Dynamic Pruning for Large Speech Foundation Models","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-07T14:29:09.440497Z"},"links":{"citing_paper":"/paper/2505.18860"},"observation_digest":"sha256:4fdc5385b28fd7baa0d85e687f8b72833af744d797fe2e5be9194110de45c731","observation_id":"8c2e6f08-56d5-4ed9-bf0d-5472dee330ef","resolution":{"observed_at":"2026-08-07T14:29:22.948762Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:29:22.518743Z","title":"Distil-whisper: Robust knowledge distillation via large-scale pseudo labelling,","venue":null,"work_id":"7f25debf-49f6-430f-936b-1bf743340f8d","year":2023},"citing_paper":{"arxiv_id":"2505.18860","last_updated":"2025-05-24T20:40:51Z","snapshot_observed_at":"2026-08-17T09:59:49.571743Z","submitted_at":"2025-05-24T20:40:51Z","title":"Context-Driven Dynamic Pruning for Large Speech Foundation Models","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-07T14:29:09.561275Z"},"links":{"citing_paper":"/paper/2505.18860"},"observation_digest":"sha256:4e3afdd7d3aef00d79bfa2612b5961d897c7b7e80c05907da9e96a66ae62c548","observation_id":"947f67ed-b0ce-43b7-bf5d-60bc5a84be26","resolution":{"observed_at":"2026-08-07T14:29:22.691275Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:29:22.292775Z","title":"Distilhubert: Speech representation learning by layer-wise distillation of hidden-unit bert,","venue":null,"work_id":"5f957f44-8fb5-4326-94d6-9029a684bcd7","year":2022},"citing_paper":{"arxiv_id":"2505.18860","last_updated":"2025-05-24T20:40:51Z","snapshot_observed_at":"2026-08-17T09:59:49.571743Z","submitted_at":"2025-05-24T20:40:51Z","title":"Context-Driven Dynamic Pruning for Large Speech Foundation Models","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-07T14:29:09.685508Z"},"links":{"citing_paper":"/paper/2505.18860"},"observation_digest":"sha256:75c6c2748ed2a16c2c76de196023be03fa8f4ab05a3099b00e0695dce0b56b38","observation_id":"0b46909b-cb61-4903-9695-888ae3a8762e","resolution":{"observed_at":"2026-08-07T14:29:22.376137Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:29:21.985609Z","title":"4-bit quantization of lstm- based speech recognition models,","venue":null,"work_id":"3fba16fa-749c-486c-a9dd-82173cbefef7","year":2021},"citing_paper":{"arxiv_id":"2505.18860","last_updated":"2025-05-24T20:40:51Z","snapshot_observed_at":"2026-08-17T09:59:49.571743Z","submitted_at":"2025-05-24T20:40:51Z","title":"Context-Driven Dynamic Pruning for Large Speech Foundation Models","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-07T14:29:10.029344Z"},"links":{"citing_paper":"/paper/2505.18860"},"observation_digest":"sha256:ed6cc0c82b69d754dbe32dc3a216204bf97fa974ce9ac28167b7549066bb73b4","observation_id":"47b61b29-6d5f-4dac-80f5-2334f8006ab4","resolution":{"observed_at":"2026-08-07T14:29:22.098308Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:29:21.766726Z","title":"2-bit conformer quantization for automatic speech recog- nition,","venue":null,"work_id":"f17c14d1-46b3-4c9b-b51e-f69b334847cf","year":2023},"citing_paper":{"arxiv_id":"2505.18860","last_updated":"2025-05-24T20:40:51Z","snapshot_observed_at":"2026-08-17T09:59:49.571743Z","submitted_at":"2025-05-24T20:40:51Z","title":"Context-Driven Dynamic Pruning for Large Speech Foundation Models","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-07T14:29:10.173876Z"},"links":{"citing_paper":"/paper/2505.18860"},"observation_digest":"sha256:8478dd5c00105e96e23ee346c01b42199125e37496fd1d580e4d6ec57de65263","observation_id":"07440e7e-6c8d-4ca5-9f4c-86a02e0a6619","resolution":{"observed_at":"2026-08-07T14:29:21.876154Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:29:21.568956Z","title":"Usm-lite: Quan- tization and sparsity aware fine-tuning for speech recognition with universal speech models,","venue":null,"work_id":"3741181e-8193-4385-995b-b40c5d4817ff","year":2024},"citing_paper":{"arxiv_id":"2505.18860","last_updated":"2025-05-24T20:40:51Z","snapshot_observed_at":"2026-08-17T09:59:49.571743Z","submitted_at":"2025-05-24T20:40:51Z","title":"Context-Driven Dynamic Pruning for Large Speech Foundation Models","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-07T14:29:10.285353Z"},"links":{"citing_paper":"/paper/2505.18860"},"observation_digest":"sha256:c33cd01a540e4106d247c9b6c688fdec6404412b91bd9330cd20f6347e888658","observation_id":"76dfb02b-3a95-4d89-8df4-8838869252db","resolution":{"observed_at":"2026-08-07T14:29:21.684343Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:29:21.369461Z","title":"Learning N: M fine-grained struc- tured sparse neural networks from scratch,","venue":null,"work_id":"99f9cecf-db28-4733-a179-360b6ca938dd","year":2021},"citing_paper":{"arxiv_id":"2505.18860","last_updated":"2025-05-24T20:40:51Z","snapshot_observed_at":"2026-08-17T09:59:49.571743Z","submitted_at":"2025-05-24T20:40:51Z","title":"Context-Driven Dynamic Pruning for Large Speech Foundation Models","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-07T14:29:10.397113Z"},"links":{"citing_paper":"/paper/2505.18860"},"observation_digest":"sha256:0ee4aa06561ee22c78a844842962c2343af168cf8659fde224d8a8720a4e9d58","observation_id":"cce01abf-c812-4bf9-868c-b03b518e456c","resolution":{"observed_at":"2026-08-07T14:29:21.455273Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:29:21.098911Z","title":"Learning sparse neu- ral networks throughl 0 regularization,","venue":null,"work_id":"82b93bf5-3254-4143-8d44-c21e21341c10","year":2018},"citing_paper":{"arxiv_id":"2505.18860","last_updated":"2025-05-24T20:40:51Z","snapshot_observed_at":"2026-08-17T09:59:49.571743Z","submitted_at":"2025-05-24T20:40:51Z","title":"Context-Driven Dynamic Pruning for Large Speech Foundation Models","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-07T14:29:10.515004Z"},"links":{"citing_paper":"/paper/2505.18860"},"observation_digest":"sha256:c7cd964cb7b5ed5f9b6e700fd345f3f73ba9f3c4c559675c0ca19fd838f53ae1","observation_id":"8ce8656a-147f-4bbc-8b95-6ebca5ddb383","resolution":{"observed_at":"2026-08-07T14:29:21.246779Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:29:20.879430Z","title":"Parp: Prune, adjust and re-prune for self-supervised speech recognition,","venue":null,"work_id":"c9fb1d46-dc5f-4fed-b861-cd646989483e","year":2021},"citing_paper":{"arxiv_id":"2505.18860","last_updated":"2025-05-24T20:40:51Z","snapshot_observed_at":"2026-08-17T09:59:49.571743Z","submitted_at":"2025-05-24T20:40:51Z","title":"Context-Driven Dynamic Pruning for Large Speech Foundation Models","version":1},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-07T14:29:10.633905Z"},"links":{"citing_paper":"/paper/2505.18860"},"observation_digest":"sha256:8ef4aca63cb3688c92279d9cd615602bc343e6fc3e8b23113c07297a59157bb0","observation_id":"60a55caa-6c93-4af9-8017-50572f3b4afc","resolution":{"observed_at":"2026-08-07T14:29:21.039024Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:29:20.630953Z","title":"Structured pruning of self-supervised pre-trained models for speech recog- nition and understanding,","venue":null,"work_id":"a91d19a2-7f21-471d-a407-024e8419dcd7","year":2023},"citing_paper":{"arxiv_id":"2505.18860","last_updated":"2025-05-24T20:40:51Z","snapshot_observed_at":"2026-08-17T09:59:49.571743Z","submitted_at":"2025-05-24T20:40:51Z","title":"Context-Driven Dynamic Pruning for Large Speech Foundation Models","version":1},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-07T14:29:10.791637Z"},"links":{"citing_paper":"/paper/2505.18860"},"observation_digest":"sha256:b25b796675bca4b12581cd6c09af01979a58ca314673899a58c0990cfceacb8f","observation_id":"fb056d90-36be-4362-bb12-716633aa052e","resolution":{"observed_at":"2026-08-07T14:29:20.777318Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:29:20.286798Z","title":"Context-aware dynamic pruning for speech foundation models,","venue":null,"work_id":"14fe8ce2-3550-4e5c-b61b-d3db4f15764b","year":2025},"citing_paper":{"arxiv_id":"2505.18860","last_updated":"2025-05-24T20:40:51Z","snapshot_observed_at":"2026-08-17T09:59:49.571743Z","submitted_at":"2025-05-24T20:40:51Z","title":"Context-Driven Dynamic Pruning for Large Speech Foundation Models","version":1},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-07T14:29:10.934814Z"},"links":{"citing_paper":"/paper/2505.18860"},"observation_digest":"sha256:add22ca690226741e09795ebb7b47e9aec0edb1c51984511be644e21aa1be860","observation_id":"27d201b7-0da7-42cf-856b-a2b6dbffc428","resolution":{"observed_at":"2026-08-07T14:29:20.471808Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:29:20.028197Z","title":"Dphubert: Joint distillation and pruning of self-supervised speech models,","venue":null,"work_id":"88e9d69f-64af-4341-94df-fe9b798cdba9","year":2023},"citing_paper":{"arxiv_id":"2505.18860","last_updated":"2025-05-24T20:40:51Z","snapshot_observed_at":"2026-08-17T09:59:49.571743Z","submitted_at":"2025-05-24T20:40:51Z","title":"Context-Driven Dynamic Pruning for Large Speech Foundation Models","version":1},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-07T14:29:11.115509Z"},"links":{"citing_paper":"/paper/2505.18860"},"observation_digest":"sha256:a99f400f8ce708c243de5a5fe1e4e69a6a973a5e022d5621be4f182322bd9231","observation_id":"df93b72c-fd0e-464f-85fb-e18b5b534fc4","resolution":{"observed_at":"2026-08-07T14:29:20.160846Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:29:19.740906Z","title":"Dynamic to- ken pruning in plain vision transformers for semantic segmenta- tion,","venue":null,"work_id":"224fd30f-aee0-429d-bfa3-d724846ac99a","year":2023},"citing_paper":{"arxiv_id":"2505.18860","last_updated":"2025-05-24T20:40:51Z","snapshot_observed_at":"2026-08-17T09:59:49.571743Z","submitted_at":"2025-05-24T20:40:51Z","title":"Context-Driven Dynamic Pruning for Large Speech Foundation Models","version":1},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-07T14:29:11.335602Z"},"links":{"citing_paper":"/paper/2505.18860"},"observation_digest":"sha256:3c9ce551849fe675844f5c26c8b0ae907da18bb18f6f0c1f585c5c576fe360e1","observation_id":"c9c5d0b1-8907-4e47-8d91-f1416af765a5","resolution":{"observed_at":"2026-08-07T14:29:19.874510Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:29:19.388705Z","title":"Trainable dynamic subsampling for end-to-end speech recognition,","venue":null,"work_id":"b630ac9e-e714-4ef8-9f10-80831a7374cd","year":2019},"citing_paper":{"arxiv_id":"2505.18860","last_updated":"2025-05-24T20:40:51Z","snapshot_observed_at":"2026-08-17T09:59:49.571743Z","submitted_at":"2025-05-24T20:40:51Z","title":"Context-Driven Dynamic Pruning for Large Speech Foundation Models","version":1},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-08-07T14:29:11.520782Z"},"links":{"citing_paper":"/paper/2505.18860"},"observation_digest":"sha256:10296dac4b274f0a630831499ce40e6cc0baa14d5b4cd20bb12a8f136778ff5c","observation_id":"3c3be4cc-d8dd-49ea-bf55-00f3587a3845","resolution":{"observed_at":"2026-08-07T14:29:19.582075Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1603.08983","last_updated":"2017-02-21T16:21:21Z","snapshot_observed_at":"2026-08-19T09:41:48.169666Z","submitted_at":"2016-03-29T22:09:00Z","title":"Adaptive Computation Time for Recurrent Neural Networks","version":6},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1603.08983","snapshot_observed_at":"2026-08-07T14:29:11.652369Z","title":"Adaptive computation time for recurrent neural net- works,","venue":null,"work_id":null,"year":2016},"citing_paper":{"arxiv_id":"2505.18860","last_updated":"2025-05-24T20:40:51Z","snapshot_observed_at":"2026-08-17T09:59:49.571743Z","submitted_at":"2025-05-24T20:40:51Z","title":"Context-Driven Dynamic Pruning for Large Speech Foundation Models","version":1},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-08-07T14:29:11.652369Z"},"links":{"cited_paper":"/paper/1603.08983","citing_paper":"/paper/2505.18860"},"observation_digest":"sha256:fc82f00c5e8faa9cd4bfdd30dd94f5570765185a45c3b65eb52641309296da55","observation_id":"c2408415-ecd6-4a59-8198-bc6bb42814da","resolution":{"observed_at":"2026-08-07T14:29:11.652369Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:29:19.094764Z","title":"Avoid overthinking in self-supervised models for speech recognition,","venue":null,"work_id":"0c33c0e6-e9b6-4065-95df-c0a9fc71fc05","year":2023},"citing_paper":{"arxiv_id":"2505.18860","last_updated":"2025-05-24T20:40:51Z","snapshot_observed_at":"2026-08-17T09:59:49.571743Z","submitted_at":"2025-05-24T20:40:51Z","title":"Context-Driven Dynamic Pruning for Large Speech Foundation Models","version":1},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-08-07T14:29:11.821394Z"},"links":{"citing_paper":"/paper/2505.18860"},"observation_digest":"sha256:5b5e03f839d405d934a48ca34a93af7590b32396653025b8199695dddc6b044f","observation_id":"d8036dd9-3391-4dbf-95cd-52f212778d39","resolution":{"observed_at":"2026-08-07T14:29:19.208376Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:29:18.749833Z","title":"Efficient sequence transduction by jointly predicting tokens and durations,","venue":null,"work_id":"cbb919f8-4e4a-4aa6-ab65-7c140d92de21","year":2023},"citing_paper":{"arxiv_id":"2505.18860","last_updated":"2025-05-24T20:40:51Z","snapshot_observed_at":"2026-08-17T09:59:49.571743Z","submitted_at":"2025-05-24T20:40:51Z","title":"Context-Driven Dynamic Pruning for Large Speech Foundation Models","version":1},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-08-07T14:29:11.957968Z"},"links":{"citing_paper":"/paper/2505.18860"},"observation_digest":"sha256:8fa90df407859c621bd703e209bbaa76026bada62f4026626d3de56ee3df4acd","observation_id":"bc69b650-a27a-4ba4-a1d2-79b67cdcc535","resolution":{"observed_at":"2026-08-07T14:29:18.920535Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:29:18.466501Z","title":"I3d: Transformer architectures with input-dependent dynamic depth for speech recognition,","venue":null,"work_id":"25d7bd0c-68df-4adb-8894-353ebecbfaaa","year":2023},"citing_paper":{"arxiv_id":"2505.18860","last_updated":"2025-05-24T20:40:51Z","snapshot_observed_at":"2026-08-17T09:59:49.571743Z","submitted_at":"2025-05-24T20:40:51Z","title":"Context-Driven Dynamic Pruning for Large Speech Foundation Models","version":1},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-08-07T14:29:12.085678Z"},"links":{"citing_paper":"/paper/2505.18860"},"observation_digest":"sha256:3bc4c345cb03fd849904e5aba943d984b6748897a7433b109766368f3fa8e533","observation_id":"807d090c-9764-43a7-9bf3-dd428ab3674f","resolution":{"observed_at":"2026-08-07T14:29:18.600487Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:29:18.146989Z","title":"Ecapa-tdnn: Emphasized channel attention, propagation and aggregation in tdnn based speaker verification,","venue":null,"work_id":"856c3d2b-bbb9-49ba-b72e-cff8a5f8533e","year":2020},"citing_paper":{"arxiv_id":"2505.18860","last_updated":"2025-05-24T20:40:51Z","snapshot_observed_at":"2026-08-17T09:59:49.571743Z","submitted_at":"2025-05-24T20:40:51Z","title":"Context-Driven Dynamic Pruning for Large Speech Foundation Models","version":1},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-08-07T14:29:12.212950Z"},"links":{"citing_paper":"/paper/2505.18860"},"observation_digest":"sha256:6e9de22f3516d883d46b4a824d8b40013b42067c1bf1c1e292862fc903459fa6","observation_id":"41d26a1a-a7e0-40be-abe7-5adc63ced150","resolution":{"observed_at":"2026-08-07T14:29:18.310215Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:29:17.790735Z","title":"Beats: audio pre-training with acoustic tok- enizers,","venue":null,"work_id":"dbcc366b-484d-46d8-a70b-f6f3ee9ea5a9","year":2023},"citing_paper":{"arxiv_id":"2505.18860","last_updated":"2025-05-24T20:40:51Z","snapshot_observed_at":"2026-08-17T09:59:49.571743Z","submitted_at":"2025-05-24T20:40:51Z","title":"Context-Driven Dynamic Pruning for Large Speech Foundation Models","version":1},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-08-07T14:29:12.414497Z"},"links":{"citing_paper":"/paper/2505.18860"},"observation_digest":"sha256:395b7b12661ca4d83cbff4f931f3e0033a16cff191a220f68c52520560c5cf70","observation_id":"de839497-785b-48a0-b39d-867effb51078","resolution":{"observed_at":"2026-08-07T14:29:17.974233Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:29:17.539068Z","title":"Uriel and lang2vec: Representing languages as typo- logical, geographical, and phylogenetic vectors,","venue":null,"work_id":"f95c7342-40d9-40a4-8fd3-525349ac01d0","year":2017},"citing_paper":{"arxiv_id":"2505.18860","last_updated":"2025-05-24T20:40:51Z","snapshot_observed_at":"2026-08-17T09:59:49.571743Z","submitted_at":"2025-05-24T20:40:51Z","title":"Context-Driven Dynamic Pruning for Large Speech Foundation Models","version":1},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-08-07T14:29:12.601790Z"},"links":{"citing_paper":"/paper/2505.18860"},"observation_digest":"sha256:97d02a66e74ebc3381dcbae56195eb097e50577823f228d5cf87bb46d16d5dd6","observation_id":"ece424b7-361d-4f13-82f8-836a5c354096","resolution":{"observed_at":"2026-08-07T14:29:17.662502Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:29:17.246585Z","title":"Re- thinking pruning for accelerating deep inference at the edge,","venue":null,"work_id":"7c3760e5-de32-430b-9fdf-e59de05cea9b","year":2020},"citing_paper":{"arxiv_id":"2505.18860","last_updated":"2025-05-24T20:40:51Z","snapshot_observed_at":"2026-08-17T09:59:49.571743Z","submitted_at":"2025-05-24T20:40:51Z","title":"Context-Driven Dynamic Pruning for Large Speech Foundation Models","version":1},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-08-07T14:29:12.827792Z"},"links":{"citing_paper":"/paper/2505.18860"},"observation_digest":"sha256:8b1c6961680b8c4ed5671bd2506ddbf8ec3e26c6fcfde20978e981f4213c12a5","observation_id":"62907125-08bd-44f3-8e60-ee00e0e7b91b","resolution":{"observed_at":"2026-08-07T14:29:17.344486Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:29:16.916284Z","title":"Audio lottery: Speech recog- nition made ultra-lightweight, noise-robust, and transferable,","venue":null,"work_id":"b6794086-79b1-41ea-b21e-61fbdca896d2","year":2021},"citing_paper":{"arxiv_id":"2505.18860","last_updated":"2025-05-24T20:40:51Z","snapshot_observed_at":"2026-08-17T09:59:49.571743Z","submitted_at":"2025-05-24T20:40:51Z","title":"Context-Driven Dynamic Pruning for Large Speech Foundation Models","version":1},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-08-07T14:29:13.005300Z"},"links":{"citing_paper":"/paper/2505.18860"},"observation_digest":"sha256:6d5dfdbf71fa09276b4745c0bcb530d8a9c96f95dd4becb6ce7784350c06f792","observation_id":"dce3d83e-e8c3-4da3-834e-89887170107b","resolution":{"observed_at":"2026-08-07T14:29:17.042974Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:29:16.636951Z","title":"Compute cost amortized transformer for streaming asr,","venue":null,"work_id":"56d5160d-2f6a-4a3c-bbe7-570aa047298e","year":2022},"citing_paper":{"arxiv_id":"2505.18860","last_updated":"2025-05-24T20:40:51Z","snapshot_observed_at":"2026-08-17T09:59:49.571743Z","submitted_at":"2025-05-24T20:40:51Z","title":"Context-Driven Dynamic Pruning for Large Speech Foundation Models","version":1},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-08-07T14:29:13.188516Z"},"links":{"citing_paper":"/paper/2505.18860"},"observation_digest":"sha256:d9a2d4c3046c2b1746437bc0d2feb5972c76362b985d28e8d1512c486d48d339","observation_id":"25c4276f-ee1c-4af4-947e-61d5aff56b71","resolution":{"observed_at":"2026-08-07T14:29:16.717469Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:29:16.349107Z","title":"Amortized neural networks for low-latency speech recognition,","venue":null,"work_id":"e20707bd-c865-4cfb-af2e-9150aebee7e3","year":2021},"citing_paper":{"arxiv_id":"2505.18860","last_updated":"2025-05-24T20:40:51Z","snapshot_observed_at":"2026-08-17T09:59:49.571743Z","submitted_at":"2025-05-24T20:40:51Z","title":"Context-Driven Dynamic Pruning for Large Speech Foundation Models","version":1},"reference_index":36,"source":"pdf_text","source_observed_at":"2026-08-07T14:29:13.336662Z"},"links":{"citing_paper":"/paper/2505.18860"},"observation_digest":"sha256:82f20bfacaa7d1f8392acf46749ed0ffdc4bc3a4df75032eb5336c9d7598b413","observation_id":"debfcfc5-2afc-4cd3-b2b2-77768e05cc4c","resolution":{"observed_at":"2026-08-07T14:29:16.505429Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:29:16.067369Z","title":"A study of the recur- rent neural network encoder-decoder for large vocabulary speech recognition,","venue":null,"work_id":"9d990056-aab5-45dd-b258-481a17ea1f36","year":2015},"citing_paper":{"arxiv_id":"2505.18860","last_updated":"2025-05-24T20:40:51Z","snapshot_observed_at":"2026-08-17T09:59:49.571743Z","submitted_at":"2025-05-24T20:40:51Z","title":"Context-Driven Dynamic Pruning for Large Speech Foundation Models","version":1},"reference_index":37,"source":"pdf_text","source_observed_at":"2026-08-07T14:29:13.481442Z"},"links":{"citing_paper":"/paper/2505.18860"},"observation_digest":"sha256:3472abdfadc019ce60ba36b2e75a01be0e4e09939cb42685152047b6eb7ad8a6","observation_id":"8912c93c-6e55-4e94-829d-ba5b2c26c06a","resolution":{"observed_at":"2026-08-07T14:29:16.219668Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:29:15.805357Z","title":"Adaptive feature selection for end-to-end speech translation,","venue":null,"work_id":"e210257f-af47-43fa-bdc6-6bd29296d0d4","year":2020},"citing_paper":{"arxiv_id":"2505.18860","last_updated":"2025-05-24T20:40:51Z","snapshot_observed_at":"2026-08-17T09:59:49.571743Z","submitted_at":"2025-05-24T20:40:51Z","title":"Context-Driven Dynamic Pruning for Large Speech Foundation Models","version":1},"reference_index":38,"source":"pdf_text","source_observed_at":"2026-08-07T14:29:13.618980Z"},"links":{"citing_paper":"/paper/2505.18860"},"observation_digest":"sha256:0e965352e7f94001aa64bfce0abc8786c78f452ef9d12af652e52f8e846258a5","observation_id":"aa95ee3b-d6b3-4250-916f-a0f81bdb3000","resolution":{"observed_at":"2026-08-07T14:29:15.935341Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:29:15.413323Z","title":"Categorical reparameterization with gumbel-softmax,","venue":null,"work_id":"f3cf5e5c-42c3-4a19-b270-3a71e8929f51","year":2017},"citing_paper":{"arxiv_id":"2505.18860","last_updated":"2025-05-24T20:40:51Z","snapshot_observed_at":"2026-08-17T09:59:49.571743Z","submitted_at":"2025-05-24T20:40:51Z","title":"Context-Driven Dynamic Pruning for Large Speech Foundation Models","version":1},"reference_index":39,"source":"pdf_text","source_observed_at":"2026-08-07T14:29:13.787442Z"},"links":{"citing_paper":"/paper/2505.18860"},"observation_digest":"sha256:ee17a4b20dce39bfb83da8d1c1c549fd44a30e14458d08fa23ef0e0ae6e06cdd","observation_id":"77a5d6af-230b-48ed-8f07-88e386bfe0ce","resolution":{"observed_at":"2026-08-07T14:29:15.601396Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:29:14.990568Z","title":"MLP-based architecture with variable length input for automatic speech recognition,","venue":null,"work_id":"bce1aeca-c2ba-4bb1-9dfb-ec432ea95195","year":2022},"citing_paper":{"arxiv_id":"2505.18860","last_updated":"2025-05-24T20:40:51Z","snapshot_observed_at":"2026-08-17T09:59:49.571743Z","submitted_at":"2025-05-24T20:40:51Z","title":"Context-Driven Dynamic Pruning for Large Speech Foundation Models","version":1},"reference_index":40,"source":"pdf_text","source_observed_at":"2026-08-07T14:29:13.915098Z"},"links":{"citing_paper":"/paper/2505.18860"},"observation_digest":"sha256:83a7823faeb0e0d68a239e2db664225b8a2cb9195022ffcb728d07903f0c489b","observation_id":"a144d106-d681-4dfc-8988-804fb9f7bb48","resolution":{"observed_at":"2026-08-07T14:29:15.178206Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:29:14.696612Z","title":"E-branchformer: Branchformer with enhanced merging for speech recognition,","venue":null,"work_id":"341cff35-3768-4d15-97f4-8b2ba8127488","year":2023},"citing_paper":{"arxiv_id":"2505.18860","last_updated":"2025-05-24T20:40:51Z","snapshot_observed_at":"2026-08-17T09:59:49.571743Z","submitted_at":"2025-05-24T20:40:51Z","title":"Context-Driven Dynamic Pruning for Large Speech Foundation Models","version":1},"reference_index":41,"source":"pdf_text","source_observed_at":"2026-08-07T14:29:14.044902Z"},"links":{"citing_paper":"/paper/2505.18860"},"observation_digest":"sha256:1979d93f48e20e3272b68b90c1dd4b7b204d12130df0b3fe632d4e4a4de3a615","observation_id":"22592b5e-1e2e-4f5e-9a14-bc14b57e2c82","resolution":{"observed_at":"2026-08-07T14:29:14.864273Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:29:14.398933Z","title":"Europarl-st: A multilingual corpus for speech translation of parliamentary de- bates,","venue":null,"work_id":"7b7f3cae-732a-4882-ae93-d21cbfbafd51","year":2020},"citing_paper":{"arxiv_id":"2505.18860","last_updated":"2025-05-24T20:40:51Z","snapshot_observed_at":"2026-08-17T09:59:49.571743Z","submitted_at":"2025-05-24T20:40:51Z","title":"Context-Driven Dynamic Pruning for Large Speech Foundation Models","version":1},"reference_index":42,"source":"pdf_text","source_observed_at":"2026-08-07T14:29:14.171935Z"},"links":{"citing_paper":"/paper/2505.18860"},"observation_digest":"sha256:fbc1081ef118c47959af88a46b003c77761b60790254689ab4fb46e84b0fcb5a","observation_id":"f81c8cda-f7ad-43f0-92cf-34f9fb0745a9","resolution":{"observed_at":"2026-08-07T14:29:14.531207Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}}],"paper":{"arxiv_id":"2505.18860","last_updated":"2025-05-24T20:40:51Z","latest_version":1,"primary_category":"eess.AS","snapshot_observed_at":"2026-08-17T09:59:49.571743Z","submitted_at":"2025-05-24T20:40:51Z","title":"Context-Driven Dynamic Pruning for Large Speech Foundation Models"},"reference_resolution":{"displayed":42,"state_counts":{"malformed_identifier":1,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":8,"verified_exact":0,"verified_fuzzy":33},"total_outbound_references":42},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"thesis":"As of 23 August 2026, this Paper Citation Record lists 42 of 42 outbound references and 2 inbound Pith citation observations for arXiv:2505.18860."}