{"as_of":"2026-08-10T18:25:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:24da9a0f2d131fbf849939c444f545897db502035915f54d3468a7f416955f73","coverage":[{"denominator":24,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":24,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-06T23:50:42.272617Z","state":"measured"},{"denominator":25,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":25,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-10T06:31:04.303077+00:00","state":"measured"},{"denominator":1,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":1,"source":"paper_references, paper_reference_links","source_observed_at":"2026-06-28T17:06:02.978205Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"arxiv_reference","source_observed_at":"2026-06-28T17:12:25.094606Z","state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2506.15912","last_updated":"2025-06-18T23:16:02Z","snapshot_observed_at":"2026-08-10T09:31:23.846954Z","submitted_at":"2025-06-18T23:16:02Z","title":"Early Attentive Sparsification Accelerates Neural Speech Transcription","version":1},"cited_work":{"arxiv_id":"2506.15912","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2506.15912","snapshot_observed_at":"2026-06-28T17:12:25.094606Z","title":"arXiv preprint arXiv:2506.15912 , year=","venue":null,"work_id":"b9ac0537-8c85-4442-928d-5d386c989e43","year":null},"citing_paper":{"arxiv_id":"2606.01483","last_updated":"2026-05-31T22:54:57Z","snapshot_observed_at":"2026-08-04T15:12:58.596963Z","submitted_at":"2026-05-31T22:54:57Z","title":"MURMUR: An Efficient Inference System for Long-Form ASR","version":1},"reference_index":32,"source":"arxiv_source","source_observed_at":"2026-06-28T17:06:02.978205Z"},"links":{"cited_paper":"/paper/2506.15912","citing_paper":"/paper/2606.01483"},"observation_digest":"sha256:50b18eb932d4ffeb2df9f5ba51e5c8965cd5870131059eeb3b20a771e040021c","observation_id":"3bcdc5c7-b931-4a93-be1d-fcedcbffbd8b","resolution":{"observed_at":"2026-06-28T17:12:25.096232Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}}],"links":{"evidence":"/evidence","html":"/paper/2506.15912/citation-record","integrity":"/paper/2506.15912/integrity","json":"/paper/2506.15912/citation-record.json","paper":"/paper/2506.15912"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T23:50:39.956510Z","title":"write newline","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2506.15912","last_updated":"2025-06-18T23:16:02Z","snapshot_observed_at":"2026-08-10T09:31:23.846954Z","submitted_at":"2025-06-18T23:16:02Z","title":"Early Attentive Sparsification Accelerates Neural Speech Transcription","version":1},"reference_index":1,"source":"arxiv_source","source_observed_at":"2026-08-06T23:50:39.956510Z"},"links":{"citing_paper":"/paper/2506.15912"},"observation_digest":"sha256:f699043488933a7af1d589b217a39842c6c6f377ffd4702e2c824beb98f7eac7","observation_id":"26ce869f-231e-499e-bdd1-b62011b308c2","resolution":{"observed_at":"2026-08-06T23:50:39.956510Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T23:50:40.073181Z","title":"Robust speech recognition via large-scale weak supervision","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.15912","last_updated":"2025-06-18T23:16:02Z","snapshot_observed_at":"2026-08-10T09:31:23.846954Z","submitted_at":"2025-06-18T23:16:02Z","title":"Early Attentive Sparsification Accelerates Neural Speech Transcription","version":1},"reference_index":2,"source":"arxiv_source","source_observed_at":"2026-08-06T23:50:40.073181Z"},"links":{"citing_paper":"/paper/2506.15912"},"observation_digest":"sha256:46810d5d43078643ce4e20bc613f46e63b3179b4afe4351bc2fedb5eb7faeb29","observation_id":"3e84de91-8dc8-4294-ac93-0fb066ed728f","resolution":{"observed_at":"2026-08-06T23:50:40.073181Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T23:50:42.825103Z","title":"Connectionist temporal classification: labelling unsegmented sequence data with recurrent neural networks","venue":null,"work_id":"fd25f95d-f2f2-4f1a-b8dc-0fbd42569969","year":2006},"citing_paper":{"arxiv_id":"2506.15912","last_updated":"2025-06-18T23:16:02Z","snapshot_observed_at":"2026-08-10T09:31:23.846954Z","submitted_at":"2025-06-18T23:16:02Z","title":"Early Attentive Sparsification Accelerates Neural Speech Transcription","version":1},"reference_index":3,"source":"arxiv_source","source_observed_at":"2026-08-06T23:50:40.164196Z"},"links":{"citing_paper":"/paper/2506.15912"},"observation_digest":"sha256:14b7c6bfdc933ae6b51c7803e4bfab3a6d95f45304294f46edff024ed0431a96","observation_id":"83cdc81e-a577-44c0-bde0-e5cdcbd47554","resolution":{"observed_at":"2026-08-06T23:50:42.831913Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T23:50:42.808490Z","title":"Deep speech 2: End-to-end speech recognition in english and mandarin","venue":null,"work_id":"8db2f388-d1fb-489a-b3ea-82c72b878a6b","year":2016},"citing_paper":{"arxiv_id":"2506.15912","last_updated":"2025-06-18T23:16:02Z","snapshot_observed_at":"2026-08-10T09:31:23.846954Z","submitted_at":"2025-06-18T23:16:02Z","title":"Early Attentive Sparsification Accelerates Neural Speech Transcription","version":1},"reference_index":4,"source":"arxiv_source","source_observed_at":"2026-08-06T23:50:40.267997Z"},"links":{"citing_paper":"/paper/2506.15912"},"observation_digest":"sha256:8a0fbf9ccf45fc28a86c966f4a8b62dfb37c1472e8f6935fd9efcb1f931c2c78","observation_id":"2a67118d-367b-40d9-b616-412eceffdb5c","resolution":{"observed_at":"2026-08-06T23:50:42.813926Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T23:50:40.347475Z","title":"wav2vec 2.0: A framework for self-supervised learning of speech representations","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2506.15912","last_updated":"2025-06-18T23:16:02Z","snapshot_observed_at":"2026-08-10T09:31:23.846954Z","submitted_at":"2025-06-18T23:16:02Z","title":"Early Attentive Sparsification Accelerates Neural Speech Transcription","version":1},"reference_index":5,"source":"arxiv_source","source_observed_at":"2026-08-06T23:50:40.347475Z"},"links":{"citing_paper":"/paper/2506.15912"},"observation_digest":"sha256:ace847eaca3b990a78d576533daa6346d40c475f41fd8d663004937f8b3e7838","observation_id":"c4b9d66e-34a6-4e9e-b97f-70bc1ae30a98","resolution":{"observed_at":"2026-08-06T23:50:40.347475Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T23:50:42.779752Z","title":"H2o: Heavy-hitter oracle for efficient generative inference of large language models","venue":null,"work_id":"0b4f0995-126e-49d9-9421-05764336b668","year":2023},"citing_paper":{"arxiv_id":"2506.15912","last_updated":"2025-06-18T23:16:02Z","snapshot_observed_at":"2026-08-10T09:31:23.846954Z","submitted_at":"2025-06-18T23:16:02Z","title":"Early Attentive Sparsification Accelerates Neural Speech Transcription","version":1},"reference_index":6,"source":"arxiv_source","source_observed_at":"2026-08-06T23:50:40.423618Z"},"links":{"citing_paper":"/paper/2506.15912"},"observation_digest":"sha256:e42343c6cb0811fcf0f1da2ebcc9017752073c800ac94752cfadfb69e22ea499","observation_id":"76fd6c3b-5e62-4340-8099-bf6eacd65f1a","resolution":{"observed_at":"2026-08-06T23:50:42.784989Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T23:50:42.761876Z","title":"Q-hitter: A better token oracle for efficient llm inference via sparse-quantized kv cache","venue":null,"work_id":"68cd51d1-61f9-4a88-8342-0ddb14903c9c","year":2024},"citing_paper":{"arxiv_id":"2506.15912","last_updated":"2025-06-18T23:16:02Z","snapshot_observed_at":"2026-08-10T09:31:23.846954Z","submitted_at":"2025-06-18T23:16:02Z","title":"Early Attentive Sparsification Accelerates Neural Speech Transcription","version":1},"reference_index":7,"source":"arxiv_source","source_observed_at":"2026-08-06T23:50:40.518367Z"},"links":{"citing_paper":"/paper/2506.15912"},"observation_digest":"sha256:c0899dd25b283eb197562dcf1a1a6bff6fd6735c42bfc52867a10fc6ff7a7667","observation_id":"997644ed-6095-45ef-96f6-424797a9b466","resolution":{"observed_at":"2026-08-06T23:50:42.767720Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T23:50:42.745815Z","title":"Spatten: Efficient sparse attention architecture with cascade token and head pruning","venue":null,"work_id":"de52e791-3f15-4693-a741-2ad8978ec708","year":2021},"citing_paper":{"arxiv_id":"2506.15912","last_updated":"2025-06-18T23:16:02Z","snapshot_observed_at":"2026-08-10T09:31:23.846954Z","submitted_at":"2025-06-18T23:16:02Z","title":"Early Attentive Sparsification Accelerates Neural Speech Transcription","version":1},"reference_index":8,"source":"arxiv_source","source_observed_at":"2026-08-06T23:50:40.589858Z"},"links":{"citing_paper":"/paper/2506.15912"},"observation_digest":"sha256:c557ff4502c98e6f230d9e6c9bf180edf90edb86ab0d480b4c355ef903c2aa0e","observation_id":"90cf1147-ac60-4bd3-b0d5-59968017aac5","resolution":{"observed_at":"2026-08-06T23:50:42.750698Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T23:50:40.692918Z","title":"Attention is all you need","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2506.15912","last_updated":"2025-06-18T23:16:02Z","snapshot_observed_at":"2026-08-10T09:31:23.846954Z","submitted_at":"2025-06-18T23:16:02Z","title":"Early Attentive Sparsification Accelerates Neural Speech Transcription","version":1},"reference_index":9,"source":"arxiv_source","source_observed_at":"2026-08-06T23:50:40.692918Z"},"links":{"citing_paper":"/paper/2506.15912"},"observation_digest":"sha256:106bcfad88108aa1d0331beadc0520d4660d32523879e9f113b1332adc301b60","observation_id":"e89276de-cf28-4e7f-998a-c29f91b6ca33","resolution":{"observed_at":"2026-08-06T23:50:40.692918Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T23:50:40.794663Z","title":"Hubert: Self-supervised speech representation learning by masked prediction of hidden units","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2506.15912","last_updated":"2025-06-18T23:16:02Z","snapshot_observed_at":"2026-08-10T09:31:23.846954Z","submitted_at":"2025-06-18T23:16:02Z","title":"Early Attentive Sparsification Accelerates Neural Speech Transcription","version":1},"reference_index":10,"source":"arxiv_source","source_observed_at":"2026-08-06T23:50:40.794663Z"},"links":{"citing_paper":"/paper/2506.15912"},"observation_digest":"sha256:7919d6bd546df482504dab4a110e0a9e00ef9f62bd31fa3114aff01fcde2ff60","observation_id":"15e63d53-68e7-448a-aa24-e66523c58420","resolution":{"observed_at":"2026-08-06T23:50:40.794663Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T23:50:40.864178Z","title":"Librispeech: An asr corpus based on public domain audio books","venue":null,"work_id":null,"year":2015},"citing_paper":{"arxiv_id":"2506.15912","last_updated":"2025-06-18T23:16:02Z","snapshot_observed_at":"2026-08-10T09:31:23.846954Z","submitted_at":"2025-06-18T23:16:02Z","title":"Early Attentive Sparsification Accelerates Neural Speech Transcription","version":1},"reference_index":11,"source":"arxiv_source","source_observed_at":"2026-08-06T23:50:40.864178Z"},"links":{"citing_paper":"/paper/2506.15912"},"observation_digest":"sha256:1f624f0041299394ccc9634079c3703ba10643c64cfb85005f72246647cda73b","observation_id":"bd3bdc37-5bfa-46be-97da-aca0e8db58c3","resolution":{"observed_at":"2026-08-06T23:50:40.864178Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2303.01037","last_updated":"2023-09-25T01:20:23Z","snapshot_observed_at":"2026-08-10T09:30:53.884156Z","submitted_at":"2023-03-02T07:47:18Z","title":"Google USM: Scaling Automatic Speech Recognition Beyond 100 Languages","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2303.01037","snapshot_observed_at":"2026-08-06T23:50:40.931247Z","title":"Google USM : Scaling automatic speech recognition beyond 100 languages","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.15912","last_updated":"2025-06-18T23:16:02Z","snapshot_observed_at":"2026-08-10T09:31:23.846954Z","submitted_at":"2025-06-18T23:16:02Z","title":"Early Attentive Sparsification Accelerates Neural Speech Transcription","version":1},"reference_index":12,"source":"arxiv_source","source_observed_at":"2026-08-06T23:50:40.931247Z"},"links":{"cited_paper":"/paper/2303.01037","citing_paper":"/paper/2506.15912"},"observation_digest":"sha256:7759d86e2810d1a7759bbeebbe7c6d70416d7804fb0d23d7d910129698a072f7","observation_id":"95397d90-3010-4bef-8bdb-cc5a507f6417","resolution":{"observed_at":"2026-08-06T23:50:40.931247Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2404.09841","last_updated":"2024-04-16T14:55:13Z","snapshot_observed_at":"2026-08-10T05:42:51.157881Z","submitted_at":"2024-04-15T14:48:43Z","title":"Anatomy of Industrial Scale Multilingual ASR","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2404.09841","snapshot_observed_at":"2026-08-06T23:50:41.036372Z","title":"Anatomy of industrial scale multilingual ASR","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.15912","last_updated":"2025-06-18T23:16:02Z","snapshot_observed_at":"2026-08-10T09:31:23.846954Z","submitted_at":"2025-06-18T23:16:02Z","title":"Early Attentive Sparsification Accelerates Neural Speech Transcription","version":1},"reference_index":13,"source":"arxiv_source","source_observed_at":"2026-08-06T23:50:41.036372Z"},"links":{"cited_paper":"/paper/2404.09841","citing_paper":"/paper/2506.15912"},"observation_digest":"sha256:7c8147f8f61da44963f29a4b0810cd1f1eb75252d79dfbc0055b08a7527a1b5a","observation_id":"32741414-4479-4748-b02d-4f9087946950","resolution":{"observed_at":"2026-08-06T23:50:41.036372Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2005.08100","last_updated":"2020-05-16T20:56:25Z","snapshot_observed_at":"2026-08-08T15:18:32.322111Z","submitted_at":"2020-05-16T20:56:25Z","title":"Conformer: Convolution-augmented Transformer for Speech Recognition","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2005.08100","snapshot_observed_at":"2026-08-06T23:50:41.136057Z","title":"Conformer: Convolution-augmented transformer for speech recognition","venue":null,"work_id":null,"year":2005},"citing_paper":{"arxiv_id":"2506.15912","last_updated":"2025-06-18T23:16:02Z","snapshot_observed_at":"2026-08-10T09:31:23.846954Z","submitted_at":"2025-06-18T23:16:02Z","title":"Early Attentive Sparsification Accelerates Neural Speech Transcription","version":1},"reference_index":14,"source":"arxiv_source","source_observed_at":"2026-08-06T23:50:41.136057Z"},"links":{"cited_paper":"/paper/2005.08100","citing_paper":"/paper/2506.15912"},"observation_digest":"sha256:57721d51b0b0557dffe226a382b0eadeb64938e2e41dc57c222bec41d6a02ec2","observation_id":"f9f662a8-0597-4ae8-9df8-e171d0b0d4d2","resolution":{"observed_at":"2026-08-06T23:50:41.136057Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T23:50:42.707238Z","title":"Fast conformer with linearly scalable attention for efficient speech recognition","venue":null,"work_id":"2e45875f-46a6-4dd9-825e-e3fe5777167b","year":2023},"citing_paper":{"arxiv_id":"2506.15912","last_updated":"2025-06-18T23:16:02Z","snapshot_observed_at":"2026-08-10T09:31:23.846954Z","submitted_at":"2025-06-18T23:16:02Z","title":"Early Attentive Sparsification Accelerates Neural Speech Transcription","version":1},"reference_index":15,"source":"arxiv_source","source_observed_at":"2026-08-06T23:50:41.237754Z"},"links":{"citing_paper":"/paper/2506.15912"},"observation_digest":"sha256:ccbd9c147b85c6c227fe236cd46722a723407f2fc9c6f22910af125a50e70252","observation_id":"5a1b4535-e985-4949-a607-69efe96e2106","resolution":{"observed_at":"2026-08-06T23:50:42.712311Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1211.3711","last_updated":"2012-11-14T19:25:21Z","snapshot_observed_at":"2026-08-10T08:23:44.451766Z","submitted_at":"2012-11-14T19:25:21Z","title":"Sequence Transduction with Recurrent Neural Networks","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1211.3711","snapshot_observed_at":"2026-08-06T23:50:41.251767Z","title":"Sequence transduction with recurrent neural networks","venue":null,"work_id":null,"year":2012},"citing_paper":{"arxiv_id":"2506.15912","last_updated":"2025-06-18T23:16:02Z","snapshot_observed_at":"2026-08-10T09:31:23.846954Z","submitted_at":"2025-06-18T23:16:02Z","title":"Early Attentive Sparsification Accelerates Neural Speech Transcription","version":1},"reference_index":16,"source":"arxiv_source","source_observed_at":"2026-08-06T23:50:41.251767Z"},"links":{"cited_paper":"/paper/1211.3711","citing_paper":"/paper/2506.15912"},"observation_digest":"sha256:bbf9d5daee2837425dc1fd08ffb734affdb70557ad268616c65f366a8e7955d4","observation_id":"14f26328-9095-4d51-b5f5-7559eb1cf5a4","resolution":{"observed_at":"2026-08-06T23:50:41.251767Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T23:50:42.690223Z","title":"Rnn-transducer with stateless prediction network","venue":null,"work_id":"15f9c207-a0b2-4e4f-a778-4db6250f30c0","year":2020},"citing_paper":{"arxiv_id":"2506.15912","last_updated":"2025-06-18T23:16:02Z","snapshot_observed_at":"2026-08-10T09:31:23.846954Z","submitted_at":"2025-06-18T23:16:02Z","title":"Early Attentive Sparsification Accelerates Neural Speech Transcription","version":1},"reference_index":17,"source":"arxiv_source","source_observed_at":"2026-08-06T23:50:41.351194Z"},"links":{"citing_paper":"/paper/2506.15912"},"observation_digest":"sha256:83bb5752409e6e37f84fdb2661836ecc0ef994d1465b57904484cd530302ef53","observation_id":"9c1766b8-510a-49ff-ae85-94215d4d34e1","resolution":{"observed_at":"2026-08-06T23:50:42.696003Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2206.13236","last_updated":"2022-06-23T12:18:03Z","snapshot_observed_at":"2026-07-06T13:25:02.101053Z","submitted_at":"2022-06-23T12:18:03Z","title":"Pruned RNN-T for fast, memory-efficient ASR training","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2206.13236","snapshot_observed_at":"2026-08-06T23:50:41.514296Z","title":"Pruned rnn-t for fast, memory-efficient asr training","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2506.15912","last_updated":"2025-06-18T23:16:02Z","snapshot_observed_at":"2026-08-10T09:31:23.846954Z","submitted_at":"2025-06-18T23:16:02Z","title":"Early Attentive Sparsification Accelerates Neural Speech Transcription","version":1},"reference_index":18,"source":"arxiv_source","source_observed_at":"2026-08-06T23:50:41.514296Z"},"links":{"cited_paper":"/paper/2206.13236","citing_paper":"/paper/2506.15912"},"observation_digest":"sha256:b93f40e96465a3639803fce641b6251617429fd1deffd2d74b4c16a6577d1c65","observation_id":"8af9b248-f005-44d7-92dd-4316206f3101","resolution":{"observed_at":"2026-08-06T23:50:41.514296Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T23:50:41.682676Z","title":"End-to-end speech recognition: A survey","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.15912","last_updated":"2025-06-18T23:16:02Z","snapshot_observed_at":"2026-08-10T09:31:23.846954Z","submitted_at":"2025-06-18T23:16:02Z","title":"Early Attentive Sparsification Accelerates Neural Speech Transcription","version":1},"reference_index":19,"source":"arxiv_source","source_observed_at":"2026-08-06T23:50:41.682676Z"},"links":{"citing_paper":"/paper/2506.15912"},"observation_digest":"sha256:44a95511e2d9dcf1d87f0578fb683b06998343eb092acb1f66acb334e3a737fd","observation_id":"9d614886-8b84-4d78-b17f-4fe27420b3be","resolution":{"observed_at":"2026-08-06T23:50:41.682676Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T23:50:42.661054Z","title":"Revisiting convolution-free transformer for speech recognition","venue":null,"work_id":"0ff3d6c8-da61-4871-9c6e-5b3213032eb3","year":2024},"citing_paper":{"arxiv_id":"2506.15912","last_updated":"2025-06-18T23:16:02Z","snapshot_observed_at":"2026-08-10T09:31:23.846954Z","submitted_at":"2025-06-18T23:16:02Z","title":"Early Attentive Sparsification Accelerates Neural Speech Transcription","version":1},"reference_index":20,"source":"arxiv_source","source_observed_at":"2026-08-06T23:50:41.799689Z"},"links":{"citing_paper":"/paper/2506.15912"},"observation_digest":"sha256:45634f1aa29b64e84f72abded800e1378971e48665e8abf2cffdbc032084dc9b","observation_id":"58f0a47e-1010-49be-bcdc-91741a049313","resolution":{"observed_at":"2026-08-06T23:50:42.667695Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2311.00430","last_updated":"2023-11-01T10:45:07Z","snapshot_observed_at":"2026-08-08T04:51:03.844048Z","submitted_at":"2023-11-01T10:45:07Z","title":"Distil-Whisper: Robust Knowledge Distillation via Large-Scale Pseudo Labelling","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2311.00430","snapshot_observed_at":"2026-08-06T23:50:41.917000Z","title":"Distil-whisper: Robust knowledge distillation via large-scale pseudo labelling","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.15912","last_updated":"2025-06-18T23:16:02Z","snapshot_observed_at":"2026-08-10T09:31:23.846954Z","submitted_at":"2025-06-18T23:16:02Z","title":"Early Attentive Sparsification Accelerates Neural Speech Transcription","version":1},"reference_index":21,"source":"arxiv_source","source_observed_at":"2026-08-06T23:50:41.917000Z"},"links":{"cited_paper":"/paper/2311.00430","citing_paper":"/paper/2506.15912"},"observation_digest":"sha256:df3c7218276805538440a8807374537e55bd34917883286ff90a610ffdfb332c","observation_id":"85b300a6-aef3-41b2-9a6f-a8d16749ac7f","resolution":{"observed_at":"2026-08-06T23:50:41.917000Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T23:50:42.065387Z","title":"Open automatic speech recognition leaderboard","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.15912","last_updated":"2025-06-18T23:16:02Z","snapshot_observed_at":"2026-08-10T09:31:23.846954Z","submitted_at":"2025-06-18T23:16:02Z","title":"Early Attentive Sparsification Accelerates Neural Speech Transcription","version":1},"reference_index":22,"source":"arxiv_source","source_observed_at":"2026-08-06T23:50:42.065387Z"},"links":{"citing_paper":"/paper/2506.15912"},"observation_digest":"sha256:77fba6acad0accdcdad3d55afaacf6712d524e5afdc4bd581f14a6b1b794ed3d","observation_id":"879b87ea-8624-420a-b173-b84d76cdc715","resolution":{"observed_at":"2026-08-06T23:50:42.065387Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2502.20583","last_updated":"2025-08-23T22:42:54Z","snapshot_observed_at":"2026-08-07T17:41:27.808822Z","submitted_at":"2025-02-27T22:52:21Z","title":"LiteASR: Efficient Automatic Speech Recognition with Low-Rank Approximation","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2502.20583","snapshot_observed_at":"2026-08-06T23:50:42.212436Z","title":"Liteasr: Efficient automatic speech recognition with low-rank approximation, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2506.15912","last_updated":"2025-06-18T23:16:02Z","snapshot_observed_at":"2026-08-10T09:31:23.846954Z","submitted_at":"2025-06-18T23:16:02Z","title":"Early Attentive Sparsification Accelerates Neural Speech Transcription","version":1},"reference_index":23,"source":"arxiv_source","source_observed_at":"2026-08-06T23:50:42.212436Z"},"links":{"cited_paper":"/paper/2502.20583","citing_paper":"/paper/2506.15912"},"observation_digest":"sha256:c7a5dbf13bea0bb7619b1004f078e5d226bbbafca42c976dee40fdd1249b6818","observation_id":"6a56947a-7a5e-4744-b517-e26ea3759166","resolution":{"observed_at":"2026-08-06T23:50:42.212436Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2307.08691","last_updated":"2023-07-17T17:50:36Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2023-07-17T17:50:36Z","title":"FlashAttention-2: Faster Attention with Better Parallelism and Work Partitioning","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2307.08691","snapshot_observed_at":"2026-08-06T23:50:42.272617Z","title":"Flashattention-2: Faster attention with better parallelism and work partitioning, 2023","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.15912","last_updated":"2025-06-18T23:16:02Z","snapshot_observed_at":"2026-08-10T09:31:23.846954Z","submitted_at":"2025-06-18T23:16:02Z","title":"Early Attentive Sparsification Accelerates Neural Speech Transcription","version":1},"reference_index":24,"source":"arxiv_source","source_observed_at":"2026-08-06T23:50:42.272617Z"},"links":{"cited_paper":"/paper/2307.08691","citing_paper":"/paper/2506.15912"},"observation_digest":"sha256:7f645acd57b12809aecbb111d32f72c47ce9585f0d54ccef64b9fa8533a69851","observation_id":"8941e34a-217b-4d57-a048-60a501fed8a9","resolution":{"observed_at":"2026-08-06T23:50:42.272617Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"paper":{"arxiv_id":"2506.15912","last_updated":"2025-06-18T23:16:02Z","latest_version":1,"primary_category":"cs.LG","snapshot_observed_at":"2026-08-10T09:31:23.846954Z","submitted_at":"2025-06-18T23:16:02Z","title":"Early Attentive Sparsification Accelerates Neural Speech Transcription"},"reference_resolution":{"displayed":24,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":16,"verified_exact":0,"verified_fuzzy":8},"total_outbound_references":24},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"thesis":"As of 10 August 2026, this Paper Citation Record lists 24 of 24 outbound references and 1 inbound Pith citation observation for arXiv:2506.15912."}