{"as_of":"2026-08-10T03:46:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:a996aa53486f0a08463a03c4df42edde38595abd89bbf573cd9cbe6a87583527","coverage":[{"denominator":44,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":44,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-07T11:34:32.822198Z","state":"measured"},{"denominator":44,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":44,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-09T06:31:02.800959+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2506.02157/citation-record","integrity":"/paper/2506.02157/integrity","json":"/paper/2506.02157/citation-record.json","paper":"/paper/2506.02157"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:34:41.584148Z","title":null,"venue":null,"work_id":"1ae75076-8a7a-40cb-aea1-7f071051e8e8","year":2020},"citing_paper":{"arxiv_id":"2506.02157","last_updated":"2025-06-02T18:37:50Z","snapshot_observed_at":"2026-08-09T18:10:24.343008Z","submitted_at":"2025-06-02T18:37:50Z","title":"HENT-SRT: Hierarchical Efficient Neural Transducer with Self-Distillation for Joint Speech Recognition and Translation","version":1},"reference_index":1,"source":"arxiv_source","source_observed_at":"2026-08-07T11:34:26.412666Z"},"links":{"citing_paper":"/paper/2506.02157"},"observation_digest":"sha256:67e4fdd09c6fbc16e38608342db6fed59a5624bd233514b8e6c384709dae40cb","observation_id":"26ed49f5-db10-4597-bcc3-e21942e003ff","resolution":{"observed_at":"2026-08-07T11:34:41.667108Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:34:41.431404Z","title":null,"venue":null,"work_id":"c2550cf5-3cfc-4710-a7f1-00db5204b180","year":2022},"citing_paper":{"arxiv_id":"2506.02157","last_updated":"2025-06-02T18:37:50Z","snapshot_observed_at":"2026-08-09T18:10:24.343008Z","submitted_at":"2025-06-02T18:37:50Z","title":"HENT-SRT: Hierarchical Efficient Neural Transducer with Self-Distillation for Joint Speech Recognition and Translation","version":1},"reference_index":2,"source":"arxiv_source","source_observed_at":"2026-08-07T11:34:26.548590Z"},"links":{"citing_paper":"/paper/2506.02157"},"observation_digest":"sha256:70d6f6dcf0ec797c057d56a91259d34fa45f35ac5c5219b571efe7c990ebdb31","observation_id":"d17725f0-435a-4694-b730-7a123268ca4b","resolution":{"observed_at":"2026-08-07T11:34:41.509039Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:34:26.649216Z","title":null,"venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2506.02157","last_updated":"2025-06-02T18:37:50Z","snapshot_observed_at":"2026-08-09T18:10:24.343008Z","submitted_at":"2025-06-02T18:37:50Z","title":"HENT-SRT: Hierarchical Efficient Neural Transducer with Self-Distillation for Joint Speech Recognition and Translation","version":1},"reference_index":3,"source":"arxiv_source","source_observed_at":"2026-08-07T11:34:26.649216Z"},"links":{"citing_paper":"/paper/2506.02157"},"observation_digest":"sha256:c278e4340cd46cf8bf6e37f78cec0ea7b83b5e0523778270b670b35c21791664","observation_id":"0a6fd052-7c75-4da8-a177-e8bda0fb13cc","resolution":{"observed_at":"2026-08-07T11:34:26.649216Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"2018.84616","doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:34:36.135833Z","title":null,"venue":null,"work_id":"22e5a7c0-2b1b-4808-85c0-fdb890c3167b","year":2018},"citing_paper":{"arxiv_id":"2506.02157","last_updated":"2025-06-02T18:37:50Z","snapshot_observed_at":"2026-08-09T18:10:24.343008Z","submitted_at":"2025-06-02T18:37:50Z","title":"HENT-SRT: Hierarchical Efficient Neural Transducer with Self-Distillation for Joint Speech Recognition and Translation","version":1},"reference_index":4,"source":"arxiv_source","source_observed_at":"2026-08-07T11:34:26.800950Z"},"links":{"citing_paper":"/paper/2506.02157"},"observation_digest":"sha256:25bc9b1276ac57ee8f5d99a784d4cab985d01255bdb371e5d58cc8814ea31453","observation_id":"890aab01-29fa-4468-a450-82f40e11902c","resolution":{"observed_at":"2026-08-07T11:34:36.255015Z","resolver_source":"raw_fallback","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:34:41.196952Z","title":null,"venue":null,"work_id":"57921b83-1831-43d7-ab48-7bc3838e46c3","year":2016},"citing_paper":{"arxiv_id":"2506.02157","last_updated":"2025-06-02T18:37:50Z","snapshot_observed_at":"2026-08-09T18:10:24.343008Z","submitted_at":"2025-06-02T18:37:50Z","title":"HENT-SRT: Hierarchical Efficient Neural Transducer with Self-Distillation for Joint Speech Recognition and Translation","version":1},"reference_index":5,"source":"arxiv_source","source_observed_at":"2026-08-07T11:34:26.969017Z"},"links":{"citing_paper":"/paper/2506.02157"},"observation_digest":"sha256:dec344aaa4ecc5d37c7f898f2c72e7b575690441fe9a7cf7b8a775db68fe20ae","observation_id":"a00928cc-c8e3-4a7c-ac49-86617499a18e","resolution":{"observed_at":"2026-08-07T11:34:41.278253Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:34:41.029565Z","title":null,"venue":null,"work_id":"6fc839df-710d-4842-907b-5d8e8c4706d3","year":2005},"citing_paper":{"arxiv_id":"2506.02157","last_updated":"2025-06-02T18:37:50Z","snapshot_observed_at":"2026-08-09T18:10:24.343008Z","submitted_at":"2025-06-02T18:37:50Z","title":"HENT-SRT: Hierarchical Efficient Neural Transducer with Self-Distillation for Joint Speech Recognition and Translation","version":1},"reference_index":6,"source":"arxiv_source","source_observed_at":"2026-08-07T11:34:27.091886Z"},"links":{"citing_paper":"/paper/2506.02157"},"observation_digest":"sha256:26f7dc1f20049d680681f2ce406d50394a74dca9e483ca344c68bb0f808536c2","observation_id":"9c7ceccb-38ea-4ff9-97af-8aa812cc7041","resolution":{"observed_at":"2026-08-07T11:34:41.097461Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":"10.18653/v1/2021.findings-acl.406","metadata_source":"doi_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:34:34.804360Z","title":null,"venue":null,"work_id":"55a194e8-3c3e-4798-84a0-594c526fd234","year":2021},"citing_paper":{"arxiv_id":"2506.02157","last_updated":"2025-06-02T18:37:50Z","snapshot_observed_at":"2026-08-09T18:10:24.343008Z","submitted_at":"2025-06-02T18:37:50Z","title":"HENT-SRT: Hierarchical Efficient Neural Transducer with Self-Distillation for Joint Speech Recognition and Translation","version":1},"reference_index":7,"source":"arxiv_source","source_observed_at":"2026-08-07T11:34:27.207491Z"},"links":{"citing_paper":"/paper/2506.02157"},"observation_digest":"sha256:8721efe5aa3e701b09e1cd34e9053ef08a5c6c1a2ac0df6e31f54b2730e64834","observation_id":"bcec8312-4c12-4a05-8584-7de9839d97e6","resolution":{"observed_at":"2026-08-07T11:34:34.930332Z","resolver_source":"doi","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:34:40.915892Z","title":null,"venue":null,"work_id":"bd763722-ca30-4aa6-a003-9ba0eed5b6ef","year":2019},"citing_paper":{"arxiv_id":"2506.02157","last_updated":"2025-06-02T18:37:50Z","snapshot_observed_at":"2026-08-09T18:10:24.343008Z","submitted_at":"2025-06-02T18:37:50Z","title":"HENT-SRT: Hierarchical Efficient Neural Transducer with Self-Distillation for Joint Speech Recognition and Translation","version":1},"reference_index":8,"source":"arxiv_source","source_observed_at":"2026-08-07T11:34:27.331246Z"},"links":{"citing_paper":"/paper/2506.02157"},"observation_digest":"sha256:094dcf3488110577688ff7acd48a4f305849e72294d874bd0102fe319ad37f49","observation_id":"e45fb4db-de3e-496e-ae52-459aa4dd53f0","resolution":{"observed_at":"2026-08-07T11:34:40.961338Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":"10.18653/v1/2021.naacl-main.151","metadata_source":"doi_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:34:34.502980Z","title":null,"venue":null,"work_id":"be3bbf5e-eb2d-4d69-9005-3498d01db789","year":2021},"citing_paper":{"arxiv_id":"2506.02157","last_updated":"2025-06-02T18:37:50Z","snapshot_observed_at":"2026-08-09T18:10:24.343008Z","submitted_at":"2025-06-02T18:37:50Z","title":"HENT-SRT: Hierarchical Efficient Neural Transducer with Self-Distillation for Joint Speech Recognition and Translation","version":1},"reference_index":9,"source":"arxiv_source","source_observed_at":"2026-08-07T11:34:27.477263Z"},"links":{"citing_paper":"/paper/2506.02157"},"observation_digest":"sha256:e7f979d080902d098de8edcca7b3629b7130da1461a7a2b1c7b53df27852850a","observation_id":"4fea61ea-265e-4835-a6d1-31daeb585ec7","resolution":{"observed_at":"2026-08-07T11:34:34.628316Z","resolver_source":"doi","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":"10.18653/v1/2020.iwslt-1.8","metadata_source":"doi_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:34:34.226709Z","title":"Di Gangi, Matteo Negri, and Marco Turchi","venue":null,"work_id":"de7bdc88-f438-4de3-bca8-125598034004","year":2020},"citing_paper":{"arxiv_id":"2506.02157","last_updated":"2025-06-02T18:37:50Z","snapshot_observed_at":"2026-08-09T18:10:24.343008Z","submitted_at":"2025-06-02T18:37:50Z","title":"HENT-SRT: Hierarchical Efficient Neural Transducer with Self-Distillation for Joint Speech Recognition and Translation","version":1},"reference_index":10,"source":"arxiv_source","source_observed_at":"2026-08-07T11:34:27.597475Z"},"links":{"citing_paper":"/paper/2506.02157"},"observation_digest":"sha256:33e70c92713f2fcceb7d5f8a4b88375652a2f855f4c8889bd63330b07e4facb8","observation_id":"6b7c23d8-b848-4285-8e49-48c31e768746","resolution":{"observed_at":"2026-08-07T11:34:34.373801Z","resolver_source":"doi","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:34:40.757225Z","title":null,"venue":null,"work_id":"b112b30a-645b-49ee-a8cd-ca66af3bcf7a","year":2020},"citing_paper":{"arxiv_id":"2506.02157","last_updated":"2025-06-02T18:37:50Z","snapshot_observed_at":"2026-08-09T18:10:24.343008Z","submitted_at":"2025-06-02T18:37:50Z","title":"HENT-SRT: Hierarchical Efficient Neural Transducer with Self-Distillation for Joint Speech Recognition and Translation","version":1},"reference_index":11,"source":"arxiv_source","source_observed_at":"2026-08-07T11:34:27.761078Z"},"links":{"citing_paper":"/paper/2506.02157"},"observation_digest":"sha256:1e3f98c723d7b23847f3a5e753a67ccad66d963ddfd5beb41b39f68c29fa5146","observation_id":"ba96d074-9953-48da-ac38-645c9ce83e38","resolution":{"observed_at":"2026-08-07T11:34:40.816471Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1211.3711","last_updated":"2012-11-14T19:25:21Z","snapshot_observed_at":"2026-07-06T02:59:58.238741Z","submitted_at":"2012-11-14T19:25:21Z","title":"Sequence Transduction with Recurrent Neural Networks","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1211.3711","snapshot_observed_at":"2026-08-07T11:34:27.886727Z","title":null,"venue":null,"work_id":null,"year":2012},"citing_paper":{"arxiv_id":"2506.02157","last_updated":"2025-06-02T18:37:50Z","snapshot_observed_at":"2026-08-09T18:10:24.343008Z","submitted_at":"2025-06-02T18:37:50Z","title":"HENT-SRT: Hierarchical Efficient Neural Transducer with Self-Distillation for Joint Speech Recognition and Translation","version":1},"reference_index":12,"source":"arxiv_source","source_observed_at":"2026-08-07T11:34:27.886727Z"},"links":{"cited_paper":"/paper/1211.3711","citing_paper":"/paper/2506.02157"},"observation_digest":"sha256:3a0fa4259a8493f29e444906ca08b93ac590ac35b78ea5616e9df00a1cba136c","observation_id":"527e90c5-3bad-4634-bff9-9309cc4275ad","resolution":{"observed_at":"2026-08-07T11:34:27.886727Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:34:28.048968Z","title":null,"venue":null,"work_id":null,"year":2006},"citing_paper":{"arxiv_id":"2506.02157","last_updated":"2025-06-02T18:37:50Z","snapshot_observed_at":"2026-08-09T18:10:24.343008Z","submitted_at":"2025-06-02T18:37:50Z","title":"HENT-SRT: Hierarchical Efficient Neural Transducer with Self-Distillation for Joint Speech Recognition and Translation","version":1},"reference_index":13,"source":"arxiv_source","source_observed_at":"2026-08-07T11:34:28.048968Z"},"links":{"citing_paper":"/paper/2506.02157"},"observation_digest":"sha256:535dd2c4b8727f2932cebca6695b6e9fcb2ddb5347e152dc56fe735c0dbe7f72","observation_id":"adfa8ec0-649e-46fc-837f-6f9413f577fb","resolution":{"observed_at":"2026-08-07T11:34:28.048968Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:34:40.571809Z","title":null,"venue":null,"work_id":"46b8dec0-01b0-4f2d-8127-efe4989f396f","year":2024},"citing_paper":{"arxiv_id":"2506.02157","last_updated":"2025-06-02T18:37:50Z","snapshot_observed_at":"2026-08-09T18:10:24.343008Z","submitted_at":"2025-06-02T18:37:50Z","title":"HENT-SRT: Hierarchical Efficient Neural Transducer with Self-Distillation for Joint Speech Recognition and Translation","version":1},"reference_index":14,"source":"arxiv_source","source_observed_at":"2026-08-07T11:34:28.172652Z"},"links":{"citing_paper":"/paper/2506.02157"},"observation_digest":"sha256:d2b6cd53a02cc9b82c002df3cc2cfe527d9b7644258c0757c3b1c62d788e7445","observation_id":"5a2eb57f-f3d9-432e-819f-04aaa3733481","resolution":{"observed_at":"2026-08-07T11:34:40.645382Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:34:40.381471Z","title":null,"venue":null,"work_id":"3325d643-c661-45cc-9942-0f52139ec407","year":2023},"citing_paper":{"arxiv_id":"2506.02157","last_updated":"2025-06-02T18:37:50Z","snapshot_observed_at":"2026-08-09T18:10:24.343008Z","submitted_at":"2025-06-02T18:37:50Z","title":"HENT-SRT: Hierarchical Efficient Neural Transducer with Self-Distillation for Joint Speech Recognition and Translation","version":1},"reference_index":15,"source":"arxiv_source","source_observed_at":"2026-08-07T11:34:28.322877Z"},"links":{"citing_paper":"/paper/2506.02157"},"observation_digest":"sha256:202c487240c937f62a99ed63cf744ad9f069f329d8954e1c6e1cc312398c1787","observation_id":"04e9157e-cf0e-498e-a58f-de20cf20bc47","resolution":{"observed_at":"2026-08-07T11:34:40.456536Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:34:40.227374Z","title":"o ksal and Nurcihan Y \\","venue":null,"work_id":"31347dd9-7c93-4a8f-8376-f1579d735699","year":2020},"citing_paper":{"arxiv_id":"2506.02157","last_updated":"2025-06-02T18:37:50Z","snapshot_observed_at":"2026-08-09T18:10:24.343008Z","submitted_at":"2025-06-02T18:37:50Z","title":"HENT-SRT: Hierarchical Efficient Neural Transducer with Self-Distillation for Joint Speech Recognition and Translation","version":1},"reference_index":16,"source":"arxiv_source","source_observed_at":"2026-08-07T11:34:28.498158Z"},"links":{"citing_paper":"/paper/2506.02157"},"observation_digest":"sha256:6a4ce181d52c1cf860cac06ffee26d251e44e7f7f065fa074d712d92d9547584","observation_id":"2a5cac74-bb1d-4beb-97b7-4cf36557b6ee","resolution":{"observed_at":"2026-08-07T11:34:40.290636Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:34:40.090125Z","title":null,"venue":null,"work_id":"e074ca87-b8ef-4c4c-98d1-8c3602dfca88","year":2022},"citing_paper":{"arxiv_id":"2506.02157","last_updated":"2025-06-02T18:37:50Z","snapshot_observed_at":"2026-08-09T18:10:24.343008Z","submitted_at":"2025-06-02T18:37:50Z","title":"HENT-SRT: Hierarchical Efficient Neural Transducer with Self-Distillation for Joint Speech Recognition and Translation","version":1},"reference_index":17,"source":"arxiv_source","source_observed_at":"2026-08-07T11:34:28.708235Z"},"links":{"citing_paper":"/paper/2506.02157"},"observation_digest":"sha256:5e4a59a56f66e638fa63b8e726a9ea1d5c494779504b202641978af6917616b9","observation_id":"77a5ac04-0f77-469b-865b-e614425d1aee","resolution":{"observed_at":"2026-08-07T11:34:40.157384Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:34:39.849956Z","title":null,"venue":null,"work_id":"74940326-d369-4d5a-950f-78d8ccdc664d","year":2021},"citing_paper":{"arxiv_id":"2506.02157","last_updated":"2025-06-02T18:37:50Z","snapshot_observed_at":"2026-08-09T18:10:24.343008Z","submitted_at":"2025-06-02T18:37:50Z","title":"HENT-SRT: Hierarchical Efficient Neural Transducer with Self-Distillation for Joint Speech Recognition and Translation","version":1},"reference_index":18,"source":"arxiv_source","source_observed_at":"2026-08-07T11:34:28.851151Z"},"links":{"citing_paper":"/paper/2506.02157"},"observation_digest":"sha256:3c723e8aadc4fe031faedb84858b5297cebd981a8dcf2f309e19c583f6b607e7","observation_id":"c94d20c3-1401-4d33-856a-015d09fcea7e","resolution":{"observed_at":"2026-08-07T11:34:39.972247Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":"10.18653/v1/2020.aacl-main.58","metadata_source":"doi_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:34:33.978734Z","title":null,"venue":null,"work_id":"0bd2e84c-3049-4ced-84c1-337ad8f8017d","year":2020},"citing_paper":{"arxiv_id":"2506.02157","last_updated":"2025-06-02T18:37:50Z","snapshot_observed_at":"2026-08-09T18:10:24.343008Z","submitted_at":"2025-06-02T18:37:50Z","title":"HENT-SRT: Hierarchical Efficient Neural Transducer with Self-Distillation for Joint Speech Recognition and Translation","version":1},"reference_index":19,"source":"arxiv_source","source_observed_at":"2026-08-07T11:34:28.953691Z"},"links":{"citing_paper":"/paper/2506.02157"},"observation_digest":"sha256:ad9428d7fc9c1115cd2ef94d3d7dc328c4fb98131731912cda16f7b2779acc85","observation_id":"1d176d17-581a-44da-8d8f-ba23822b9259","resolution":{"observed_at":"2026-08-07T11:34:34.061988Z","resolver_source":"doi","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:34:39.531285Z","title":null,"venue":null,"work_id":"cdc61d0a-68bc-4a2f-9ef6-13162f14ddb4","year":2021},"citing_paper":{"arxiv_id":"2506.02157","last_updated":"2025-06-02T18:37:50Z","snapshot_observed_at":"2026-08-09T18:10:24.343008Z","submitted_at":"2025-06-02T18:37:50Z","title":"HENT-SRT: Hierarchical Efficient Neural Transducer with Self-Distillation for Joint Speech Recognition and Translation","version":1},"reference_index":20,"source":"arxiv_source","source_observed_at":"2026-08-07T11:34:29.073222Z"},"links":{"citing_paper":"/paper/2506.02157"},"observation_digest":"sha256:06fb9ac071dc226400338b8163f2e0858e7ac8fb619f3868e12ecc8dbd2f636a","observation_id":"354d0581-58ce-4efc-b80d-f6c24f1c2730","resolution":{"observed_at":"2026-08-07T11:34:39.670490Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:34:39.324341Z","title":null,"venue":null,"work_id":"28f85de2-3e23-4be7-b965-9b589b738da0","year":2021},"citing_paper":{"arxiv_id":"2506.02157","last_updated":"2025-06-02T18:37:50Z","snapshot_observed_at":"2026-08-09T18:10:24.343008Z","submitted_at":"2025-06-02T18:37:50Z","title":"HENT-SRT: Hierarchical Efficient Neural Transducer with Self-Distillation for Joint Speech Recognition and Translation","version":1},"reference_index":21,"source":"arxiv_source","source_observed_at":"2026-08-07T11:34:29.192674Z"},"links":{"citing_paper":"/paper/2506.02157"},"observation_digest":"sha256:a52bddd991289fa604a8b115a4a7d4b4f89f513fcefb1cccdd5aaef66f9fc5ff","observation_id":"f1bb5c72-55f6-4bae-96b6-b2528b051d29","resolution":{"observed_at":"2026-08-07T11:34:39.410195Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:34:29.317777Z","title":null,"venue":null,"work_id":null,"year":2005},"citing_paper":{"arxiv_id":"2506.02157","last_updated":"2025-06-02T18:37:50Z","snapshot_observed_at":"2026-08-09T18:10:24.343008Z","submitted_at":"2025-06-02T18:37:50Z","title":"HENT-SRT: Hierarchical Efficient Neural Transducer with Self-Distillation for Joint Speech Recognition and Translation","version":1},"reference_index":22,"source":"arxiv_source","source_observed_at":"2026-08-07T11:34:29.317777Z"},"links":{"citing_paper":"/paper/2506.02157"},"observation_digest":"sha256:039270b20605e5ef7eda93bfdee0ee05bedbeae0580efdb1315a614316f72a3c","observation_id":"f04753e2-bc24-42e3-864d-a06198f7a48f","resolution":{"observed_at":"2026-08-07T11:34:29.317777Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:34:39.061032Z","title":null,"venue":null,"work_id":"891014bb-0940-4771-bf5a-3f2f6b31d613","year":2009},"citing_paper":{"arxiv_id":"2506.02157","last_updated":"2025-06-02T18:37:50Z","snapshot_observed_at":"2026-08-09T18:10:24.343008Z","submitted_at":"2025-06-02T18:37:50Z","title":"HENT-SRT: Hierarchical Efficient Neural Transducer with Self-Distillation for Joint Speech Recognition and Translation","version":1},"reference_index":23,"source":"arxiv_source","source_observed_at":"2026-08-07T11:34:29.435674Z"},"links":{"citing_paper":"/paper/2506.02157"},"observation_digest":"sha256:6468c5cddebf92ae9691927b3dd58d0cbf0ff10f0e4d0d89f7ae85236449bbbd","observation_id":"c92e6018-1930-41ed-8dca-1557496548a2","resolution":{"observed_at":"2026-08-07T11:34:39.141467Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:34:29.649120Z","title":null,"venue":null,"work_id":null,"year":2002},"citing_paper":{"arxiv_id":"2506.02157","last_updated":"2025-06-02T18:37:50Z","snapshot_observed_at":"2026-08-09T18:10:24.343008Z","submitted_at":"2025-06-02T18:37:50Z","title":"HENT-SRT: Hierarchical Efficient Neural Transducer with Self-Distillation for Joint Speech Recognition and Translation","version":1},"reference_index":24,"source":"arxiv_source","source_observed_at":"2026-08-07T11:34:29.649120Z"},"links":{"citing_paper":"/paper/2506.02157"},"observation_digest":"sha256:f56537253dc4d3b0c58bac01a8861949911c7c5e00bbd1d24fdda245f81fd2d4","observation_id":"29adc20c-6e24-4754-8f5e-23fdac6da86b","resolution":{"observed_at":"2026-08-07T11:34:29.649120Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:34:38.758493Z","title":null,"venue":null,"work_id":"55940e89-378a-46dc-b79d-5a80cb1e5f8f","year":2019},"citing_paper":{"arxiv_id":"2506.02157","last_updated":"2025-06-02T18:37:50Z","snapshot_observed_at":"2026-08-09T18:10:24.343008Z","submitted_at":"2025-06-02T18:37:50Z","title":"HENT-SRT: Hierarchical Efficient Neural Transducer with Self-Distillation for Joint Speech Recognition and Translation","version":1},"reference_index":25,"source":"arxiv_source","source_observed_at":"2026-08-07T11:34:30.033048Z"},"links":{"citing_paper":"/paper/2506.02157"},"observation_digest":"sha256:ce3004a1073e5a181a1498b1baa1080f3a7376539dc075c47143b054f53c5395","observation_id":"44b23bfb-6996-45a0-bd4a-3f7a9974d44a","resolution":{"observed_at":"2026-08-07T11:34:38.869884Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:34:38.436701Z","title":"McCarthy, and Deepak Gopinath","venue":null,"work_id":"edb44203-31ef-4b8c-a9a4-6fbeb783eb59","year":2019},"citing_paper":{"arxiv_id":"2506.02157","last_updated":"2025-06-02T18:37:50Z","snapshot_observed_at":"2026-08-09T18:10:24.343008Z","submitted_at":"2025-06-02T18:37:50Z","title":"HENT-SRT: Hierarchical Efficient Neural Transducer with Self-Distillation for Joint Speech Recognition and Translation","version":1},"reference_index":26,"source":"arxiv_source","source_observed_at":"2026-08-07T11:34:30.219038Z"},"links":{"citing_paper":"/paper/2506.02157"},"observation_digest":"sha256:6b170e8d3fe02229153ecc6e80ce901392c0a30fce6055d0f9b14a45a4a2234d","observation_id":"bc39776e-1c00-4103-858b-17d7164a83c7","resolution":{"observed_at":"2026-08-07T11:34:38.572241Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:34:38.167955Z","title":null,"venue":null,"work_id":"71151700-c8c7-416c-89e9-9fd8056659a3","year":2013},"citing_paper":{"arxiv_id":"2506.02157","last_updated":"2025-06-02T18:37:50Z","snapshot_observed_at":"2026-08-09T18:10:24.343008Z","submitted_at":"2025-06-02T18:37:50Z","title":"HENT-SRT: Hierarchical Efficient Neural Transducer with Self-Distillation for Joint Speech Recognition and Translation","version":1},"reference_index":27,"source":"arxiv_source","source_observed_at":"2026-08-07T11:34:30.394588Z"},"links":{"citing_paper":"/paper/2506.02157"},"observation_digest":"sha256:ab8d5209a09e736c71eb2640d54b3a8809aa3b351fb39d429cafdc1c7f66af02","observation_id":"cf1c812f-4d2c-4d25-8b7e-b3c8ff02dfb9","resolution":{"observed_at":"2026-08-07T11:34:38.294299Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2407.11010","last_updated":"2024-06-26T07:34:53Z","snapshot_observed_at":"2026-07-06T18:46:39.497352Z","submitted_at":"2024-06-26T07:34:53Z","title":"Navigating the Minefield of MT Beam Search in Cascaded Streaming Speech Translation","version":1},"cited_work":{"arxiv_id":"2407.11010","doi":null,"metadata_source":"pith","pith_arxiv_id":"2407.11010","snapshot_observed_at":"2026-08-07T11:34:35.698458Z","title":"Navigating the Minefield of MT Beam Search in Cascaded Streaming Speech Translation","venue":"cs.CL","work_id":"28dd3fa8-9972-4e38-8382-f040e40bd4bb","year":2024},"citing_paper":{"arxiv_id":"2506.02157","last_updated":"2025-06-02T18:37:50Z","snapshot_observed_at":"2026-08-09T18:10:24.343008Z","submitted_at":"2025-06-02T18:37:50Z","title":"HENT-SRT: Hierarchical Efficient Neural Transducer with Self-Distillation for Joint Speech Recognition and Translation","version":1},"reference_index":28,"source":"arxiv_source","source_observed_at":"2026-08-07T11:34:30.484883Z"},"links":{"cited_paper":"/paper/2407.11010","citing_paper":"/paper/2506.02157"},"observation_digest":"sha256:4edebebd165ef33e7516b78d1a3e76cba1cf1b095f2d24f2b93708e21660d1da","observation_id":"b071520b-e8d6-4c1c-9eb5-c82ca01fe2e4","resolution":{"observed_at":"2026-08-07T11:34:35.812184Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:34:37.911946Z","title":null,"venue":null,"work_id":"bf3c64f5-994b-4330-9aa6-aad3c85baf95","year":2020},"citing_paper":{"arxiv_id":"2506.02157","last_updated":"2025-06-02T18:37:50Z","snapshot_observed_at":"2026-08-09T18:10:24.343008Z","submitted_at":"2025-06-02T18:37:50Z","title":"HENT-SRT: Hierarchical Efficient Neural Transducer with Self-Distillation for Joint Speech Recognition and Translation","version":1},"reference_index":29,"source":"arxiv_source","source_observed_at":"2026-08-07T11:34:30.632605Z"},"links":{"citing_paper":"/paper/2506.02157"},"observation_digest":"sha256:d8f4dea594aa91b74063de8579e50f61726866bd737490de121dadcbfd59df65","observation_id":"c9dddfd9-d458-4ff7-8ba5-ff381ccc6fd7","resolution":{"observed_at":"2026-08-07T11:34:38.011160Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":"10.21437/interspeech.2014-511","metadata_source":"doi_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:34:33.742725Z","title":null,"venue":null,"work_id":"b7de8ab7-3c1c-4213-998c-b267204adea8","year":2014},"citing_paper":{"arxiv_id":"2506.02157","last_updated":"2025-06-02T18:37:50Z","snapshot_observed_at":"2026-08-09T18:10:24.343008Z","submitted_at":"2025-06-02T18:37:50Z","title":"HENT-SRT: Hierarchical Efficient Neural Transducer with Self-Distillation for Joint Speech Recognition and Translation","version":1},"reference_index":30,"source":"arxiv_source","source_observed_at":"2026-08-07T11:34:30.833844Z"},"links":{"citing_paper":"/paper/2506.02157"},"observation_digest":"sha256:7b470156b6b6c0203e8f0067fe8025a6977f953b7cff47fe44b701a7b2a625ab","observation_id":"51f4b4dc-5d57-4990-8957-822ff21b4f2e","resolution":{"observed_at":"2026-08-07T11:34:33.858378Z","resolver_source":"doi","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:34:37.632773Z","title":null,"venue":null,"work_id":"01abbfa2-b347-42fd-876c-1131b262397a","year":2017},"citing_paper":{"arxiv_id":"2506.02157","last_updated":"2025-06-02T18:37:50Z","snapshot_observed_at":"2026-08-09T18:10:24.343008Z","submitted_at":"2025-06-02T18:37:50Z","title":"HENT-SRT: Hierarchical Efficient Neural Transducer with Self-Distillation for Joint Speech Recognition and Translation","version":1},"reference_index":31,"source":"arxiv_source","source_observed_at":"2026-08-07T11:34:30.969042Z"},"links":{"citing_paper":"/paper/2506.02157"},"observation_digest":"sha256:80f2f463b89a7e7d02e86d9049d402a1c78938cfab0ba941ac12376b83ab06b6","observation_id":"5cb3ec41-9bf8-45b5-92c2-c8f2860dbdae","resolution":{"observed_at":"2026-08-07T11:34:37.771136Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:34:37.366394Z","title":null,"venue":null,"work_id":"995f5606-6f4c-4fd7-a898-ae7bbcdb21d9","year":2023},"citing_paper":{"arxiv_id":"2506.02157","last_updated":"2025-06-02T18:37:50Z","snapshot_observed_at":"2026-08-09T18:10:24.343008Z","submitted_at":"2025-06-02T18:37:50Z","title":"HENT-SRT: Hierarchical Efficient Neural Transducer with Self-Distillation for Joint Speech Recognition and Translation","version":1},"reference_index":32,"source":"arxiv_source","source_observed_at":"2026-08-07T11:34:31.093923Z"},"links":{"citing_paper":"/paper/2506.02157"},"observation_digest":"sha256:4c99584baf41bb76a9a4ec8dc6e78ae1afbc2120d3152cd70fc8d692e59a1788","observation_id":"42a13465-cbde-4594-8f61-2ca04635421b","resolution":{"observed_at":"2026-08-07T11:34:37.496442Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":"10.21437/interspeech.2023-2004","metadata_source":"doi_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:34:33.496320Z","title":null,"venue":null,"work_id":"f7bde6b0-e9c5-4b30-b425-da7b807ad696","year":2023},"citing_paper":{"arxiv_id":"2506.02157","last_updated":"2025-06-02T18:37:50Z","snapshot_observed_at":"2026-08-09T18:10:24.343008Z","submitted_at":"2025-06-02T18:37:50Z","title":"HENT-SRT: Hierarchical Efficient Neural Transducer with Self-Distillation for Joint Speech Recognition and Translation","version":1},"reference_index":33,"source":"arxiv_source","source_observed_at":"2026-08-07T11:34:31.240081Z"},"links":{"citing_paper":"/paper/2506.02157"},"observation_digest":"sha256:a437c7ba4000de41e92f39074494ab7cb2b02f268f1f41659864e387cf866b5f","observation_id":"f8e16c53-a784-45ce-8227-d9480488767b","resolution":{"observed_at":"2026-08-07T11:34:33.618516Z","resolver_source":"doi","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2404.11619","last_updated":"2024-03-25T21:08:06Z","snapshot_observed_at":"2026-07-06T18:01:45.549839Z","submitted_at":"2024-03-25T21:08:06Z","title":"Advancing Speech Translation: A Corpus of Mandarin-English Conversational Telephone Speech","version":1},"cited_work":{"arxiv_id":"2404.11619","doi":null,"metadata_source":"pith","pith_arxiv_id":"2404.11619","snapshot_observed_at":"2026-08-07T11:34:35.400288Z","title":"Advancing Speech Translation: A Corpus of Mandarin-English Conversational Telephone Speech","venue":"eess.AS","work_id":"d9cf53c9-4f79-4e4a-9fd0-13a249804bdb","year":2024},"citing_paper":{"arxiv_id":"2506.02157","last_updated":"2025-06-02T18:37:50Z","snapshot_observed_at":"2026-08-09T18:10:24.343008Z","submitted_at":"2025-06-02T18:37:50Z","title":"HENT-SRT: Hierarchical Efficient Neural Transducer with Self-Distillation for Joint Speech Recognition and Translation","version":1},"reference_index":34,"source":"arxiv_source","source_observed_at":"2026-08-07T11:34:31.393483Z"},"links":{"cited_paper":"/paper/2404.11619","citing_paper":"/paper/2506.02157"},"observation_digest":"sha256:e1caf86cb9be446e7fbd40b732e0cd9de2e20eb7dee8f723e1b307f366b463be","observation_id":"7ae20168-a86d-412d-824c-fca98f94dc2a","resolution":{"observed_at":"2026-08-07T11:34:35.526845Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:34:37.157423Z","title":null,"venue":null,"work_id":"aac656f3-a7c3-4ae9-8dab-eabe7c733c68","year":2022},"citing_paper":{"arxiv_id":"2506.02157","last_updated":"2025-06-02T18:37:50Z","snapshot_observed_at":"2026-08-09T18:10:24.343008Z","submitted_at":"2025-06-02T18:37:50Z","title":"HENT-SRT: Hierarchical Efficient Neural Transducer with Self-Distillation for Joint Speech Recognition and Translation","version":1},"reference_index":35,"source":"arxiv_source","source_observed_at":"2026-08-07T11:34:31.508617Z"},"links":{"citing_paper":"/paper/2506.02157"},"observation_digest":"sha256:d86e44eefd0ee2c018a96b14e838c45b1eb081f2f78c206ed1193a8ed7d94296","observation_id":"d6e28113-bda8-406c-94a8-b6365e613a2c","resolution":{"observed_at":"2026-08-07T11:34:37.247803Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:34:36.959876Z","title":null,"venue":null,"work_id":"48a3e8d1-a4bf-4921-b95e-66a3975cb0f7","year":2023},"citing_paper":{"arxiv_id":"2506.02157","last_updated":"2025-06-02T18:37:50Z","snapshot_observed_at":"2026-08-09T18:10:24.343008Z","submitted_at":"2025-06-02T18:37:50Z","title":"HENT-SRT: Hierarchical Efficient Neural Transducer with Self-Distillation for Joint Speech Recognition and Translation","version":1},"reference_index":36,"source":"arxiv_source","source_observed_at":"2026-08-07T11:34:31.670166Z"},"links":{"citing_paper":"/paper/2506.02157"},"observation_digest":"sha256:f40f6c32a4b3ed0bf25e17a323cdc5413eac8e7acadfe162d3e60af6529e920d","observation_id":"e8600bb3-4008-4de6-858f-86a38cfcb3a9","resolution":{"observed_at":"2026-08-07T11:34:37.061244Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":"10.18653/v1/2023.acl-demo.38","metadata_source":"doi_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:34:33.284129Z","title":null,"venue":null,"work_id":"39b00769-548a-45d2-878f-a6b491d9d92f","year":2023},"citing_paper":{"arxiv_id":"2506.02157","last_updated":"2025-06-02T18:37:50Z","snapshot_observed_at":"2026-08-09T18:10:24.343008Z","submitted_at":"2025-06-02T18:37:50Z","title":"HENT-SRT: Hierarchical Efficient Neural Transducer with Self-Distillation for Joint Speech Recognition and Translation","version":1},"reference_index":37,"source":"arxiv_source","source_observed_at":"2026-08-07T11:34:31.817243Z"},"links":{"citing_paper":"/paper/2506.02157"},"observation_digest":"sha256:66a75a5c71c8102ae17fc8551b45534b87de536d67d7497d169e16be0e0b869e","observation_id":"9f29a2e1-97a6-4fbb-855e-b4694b2f376e","resolution":{"observed_at":"2026-08-07T11:34:33.376651Z","resolver_source":"doi","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2304.04596","last_updated":"2023-07-06T20:07:49Z","snapshot_observed_at":"2026-08-06T06:09:10.828875Z","submitted_at":"2023-04-10T14:05:22Z","title":"ESPnet-ST-v2: Multipurpose Spoken Language Translation Toolkit","version":3},"cited_work":{"arxiv_id":"2304.04596","doi":null,"metadata_source":"pith","pith_arxiv_id":"2304.04596","snapshot_observed_at":"2026-08-07T11:34:35.157973Z","title":"ESPnet-ST-v2: Multipurpose Spoken Language Translation Toolkit","venue":"cs.SD","work_id":"826a06d3-70ae-4254-8aa7-faeefd60222c","year":2023},"citing_paper":{"arxiv_id":"2506.02157","last_updated":"2025-06-02T18:37:50Z","snapshot_observed_at":"2026-08-09T18:10:24.343008Z","submitted_at":"2025-06-02T18:37:50Z","title":"HENT-SRT: Hierarchical Efficient Neural Transducer with Self-Distillation for Joint Speech Recognition and Translation","version":1},"reference_index":38,"source":"arxiv_source","source_observed_at":"2026-08-07T11:34:31.944822Z"},"links":{"cited_paper":"/paper/2304.04596","citing_paper":"/paper/2506.02157"},"observation_digest":"sha256:b75b2021fcde08e1f4c018d6c40462619bb2c873fa3ca8164db62e81169f5ae4","observation_id":"6392f00a-4175-4254-9216-1d3ee4ed74c3","resolution":{"observed_at":"2026-08-07T11:34:35.250905Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":"10.18653/v1/2022.iwslt-1.29","metadata_source":"doi_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:34:32.993246Z","title":null,"venue":null,"work_id":"e6793d1d-0172-4cd5-94f9-9303d69943db","year":2022},"citing_paper":{"arxiv_id":"2506.02157","last_updated":"2025-06-02T18:37:50Z","snapshot_observed_at":"2026-08-09T18:10:24.343008Z","submitted_at":"2025-06-02T18:37:50Z","title":"HENT-SRT: Hierarchical Efficient Neural Transducer with Self-Distillation for Joint Speech Recognition and Translation","version":1},"reference_index":39,"source":"arxiv_source","source_observed_at":"2026-08-07T11:34:32.084757Z"},"links":{"citing_paper":"/paper/2506.02157"},"observation_digest":"sha256:b6b4f5c8815aa94a9808d3b3afa637a2a35e6e10c4b1cdc8ab64e231febf28c4","observation_id":"cf0ea1a3-69d9-44e3-b8d8-80cd0d7841c2","resolution":{"observed_at":"2026-08-07T11:34:33.140467Z","resolver_source":"doi","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:34:36.707161Z","title":null,"venue":null,"work_id":"7db1c196-4110-4e75-8a80-1c42c2af8035","year":2024},"citing_paper":{"arxiv_id":"2506.02157","last_updated":"2025-06-02T18:37:50Z","snapshot_observed_at":"2026-08-09T18:10:24.343008Z","submitted_at":"2025-06-02T18:37:50Z","title":"HENT-SRT: Hierarchical Efficient Neural Transducer with Self-Distillation for Joint Speech Recognition and Translation","version":1},"reference_index":40,"source":"arxiv_source","source_observed_at":"2026-08-07T11:34:32.206610Z"},"links":{"citing_paper":"/paper/2506.02157"},"observation_digest":"sha256:956ea2ec742b27196dde269fcb49cfe64d2a38cf3ea1ab7c269bf96602fe869d","observation_id":"a31554b0-45d7-4eaf-b676-9ac15e427ac7","resolution":{"observed_at":"2026-08-07T11:34:36.817294Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2410.05101","last_updated":"2025-02-14T13:13:03Z","snapshot_observed_at":"2026-08-09T18:09:52.072757Z","submitted_at":"2024-10-07T14:56:07Z","title":"CR-CTC: Consistency regularization on CTC for improved speech recognition","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2410.05101","snapshot_observed_at":"2026-08-07T11:34:32.344603Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.02157","last_updated":"2025-06-02T18:37:50Z","snapshot_observed_at":"2026-08-09T18:10:24.343008Z","submitted_at":"2025-06-02T18:37:50Z","title":"HENT-SRT: Hierarchical Efficient Neural Transducer with Self-Distillation for Joint Speech Recognition and Translation","version":1},"reference_index":41,"source":"arxiv_source","source_observed_at":"2026-08-07T11:34:32.344603Z"},"links":{"cited_paper":"/paper/2410.05101","citing_paper":"/paper/2506.02157"},"observation_digest":"sha256:56f256ebb3b27e99b0b6c5bbce690e6f559aa85aac006bddfee37d19e8e3701b","observation_id":"bef1cf9d-1cc1-4a50-981d-152c977a0b9e","resolution":{"observed_at":"2026-08-07T11:34:32.344603Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:34:36.444570Z","title":null,"venue":null,"work_id":"65bcdf1f-f80c-4d45-8297-44eb07572d63","year":2021},"citing_paper":{"arxiv_id":"2506.02157","last_updated":"2025-06-02T18:37:50Z","snapshot_observed_at":"2026-08-09T18:10:24.343008Z","submitted_at":"2025-06-02T18:37:50Z","title":"HENT-SRT: Hierarchical Efficient Neural Transducer with Self-Distillation for Joint Speech Recognition and Translation","version":1},"reference_index":42,"source":"arxiv_source","source_observed_at":"2026-08-07T11:34:32.493596Z"},"links":{"citing_paper":"/paper/2506.02157"},"observation_digest":"sha256:29111336ae585fd41d72a3c63b66c8888b2bccfda0a1a2bb8558bcdb5cc57828","observation_id":"ea4b0487-9d67-4b15-8f29-be062b72e239","resolution":{"observed_at":"2026-08-07T11:34:36.553387Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:34:32.661208Z","title":"online\" 'onlinestring :=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2506.02157","last_updated":"2025-06-02T18:37:50Z","snapshot_observed_at":"2026-08-09T18:10:24.343008Z","submitted_at":"2025-06-02T18:37:50Z","title":"HENT-SRT: Hierarchical Efficient Neural Transducer with Self-Distillation for Joint Speech Recognition and Translation","version":1},"reference_index":43,"source":"arxiv_source","source_observed_at":"2026-08-07T11:34:32.661208Z"},"links":{"citing_paper":"/paper/2506.02157"},"observation_digest":"sha256:aeab4213667fcadc74a68c720bf703db745787d67637142e2119e1f3bafd24f1","observation_id":"b53791f0-12ab-4868-9ec4-4ea56758532e","resolution":{"observed_at":"2026-08-07T11:34:32.661208Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:34:32.822198Z","title":"write newline","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2506.02157","last_updated":"2025-06-02T18:37:50Z","snapshot_observed_at":"2026-08-09T18:10:24.343008Z","submitted_at":"2025-06-02T18:37:50Z","title":"HENT-SRT: Hierarchical Efficient Neural Transducer with Self-Distillation for Joint Speech Recognition and Translation","version":1},"reference_index":44,"source":"arxiv_source","source_observed_at":"2026-08-07T11:34:32.822198Z"},"links":{"citing_paper":"/paper/2506.02157"},"observation_digest":"sha256:89b3592a79843dc8749c984f278e9eab4af82b5bae1a1646991d4e31874472b8","observation_id":"26f93247-ff72-4e76-8f7b-abb2f600120c","resolution":{"observed_at":"2026-08-07T11:34:32.822198Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"paper":{"arxiv_id":"2506.02157","last_updated":"2025-06-02T18:37:50Z","latest_version":1,"primary_category":"cs.CL","snapshot_observed_at":"2026-08-09T18:10:24.343008Z","submitted_at":"2025-06-02T18:37:50Z","title":"HENT-SRT: Hierarchical Efficient Neural Transducer with Self-Distillation for Joint Speech Recognition and Translation"},"reference_resolution":{"displayed":44,"state_counts":{"malformed_identifier":0,"metadata_mismatch":1,"parse_uncertain":0,"unresolved":30,"verified_exact":11,"verified_fuzzy":2},"total_outbound_references":44},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"thesis":"As of 10 August 2026, this Paper Citation Record lists 44 of 44 outbound references and 0 inbound Pith citation observations for arXiv:2506.02157."}