{"as_of":"2026-08-09T06:35:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:fd7263bfcb3ee53b0503cf8468188449d8f5d4003bd37890d0b2f16568d77e90","coverage":[{"denominator":47,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":47,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-07T04:54:02.600982Z","state":"measured"},{"denominator":49,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":49,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-09T06:31:02.800959+00:00","state":"measured"},{"denominator":2,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":2,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-07T04:53:56.912097Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"arxiv_reference","source_observed_at":"2026-07-04T02:49:24.371678Z","state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2506.09448","last_updated":"2025-06-11T06:53:40Z","snapshot_observed_at":"2026-08-07T19:22:57.303552Z","submitted_at":"2025-06-11T06:53:40Z","title":"OWSM-Biasing: Contextualizing Open Whisper-Style Speech Models for Automatic Speech Recognition with Dynamic Vocabulary","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2506.09448","snapshot_observed_at":"2026-08-07T04:53:56.912097Z","title":"These models are trained on mas- sive datasets, allowing them to generalize well across multiple domains and achieve high recognition accuracy","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2506.09448","last_updated":"2025-06-11T06:53:40Z","snapshot_observed_at":"2026-08-07T19:22:57.303552Z","submitted_at":"2025-06-11T06:53:40Z","title":"OWSM-Biasing: Contextualizing Open Whisper-Style Speech Models for Automatic Speech Recognition with Dynamic Vocabulary","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-07T04:53:56.912097Z"},"links":{"cited_paper":"/paper/2506.09448","citing_paper":"/paper/2506.09448"},"observation_digest":"sha256:5092905560e137825b58a772250dd21a488ebc46c44ef5242bcbe3d2c768d215","observation_id":"59881a6c-55b3-489f-83f4-52933688c0a6","resolution":{"observed_at":"2026-08-07T04:53:56.912097Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2506.09448","last_updated":"2025-06-11T06:53:40Z","snapshot_observed_at":"2026-08-07T19:22:57.303552Z","submitted_at":"2025-06-11T06:53:40Z","title":"OWSM-Biasing: Contextualizing Open Whisper-Style Speech Models for Automatic Speech Recognition with Dynamic Vocabulary","version":1},"cited_work":{"arxiv_id":"2506.09448","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2506.09448","snapshot_observed_at":"2026-07-04T02:49:24.371678Z","title":"Owsm- biasing: Contextualizing open whisper-style speech models for asr with dynamic vocabulary,","venue":null,"work_id":"af979b6e-b461-4776-be2d-bc0965ea07ba","year":2025},"citing_paper":{"arxiv_id":"2606.19157","last_updated":"2026-06-24T04:32:31Z","snapshot_observed_at":"2026-07-06T23:54:27.624372Z","submitted_at":"2026-06-17T14:59:37Z","title":"IndicContextEval: A Benchmark for Evaluating Context Utilisation in Audio Large Language Models Across 8 Indic Languages","version":2},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-06-26T19:14:26.452851Z"},"links":{"cited_paper":"/paper/2506.09448","citing_paper":"/paper/2606.19157"},"observation_digest":"sha256:d77b86537dc07882f204a30a21e24b3b9f44245e896c05179db699ee90256e68","observation_id":"30b23701-2ee9-4692-bb78-16ef1438cc55","resolution":{"observed_at":"2026-07-04T02:49:24.373156Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}}],"links":{"evidence":"/evidence","html":"/paper/2506.09448/citation-record","integrity":"/paper/2506.09448/integrity","json":"/paper/2506.09448/citation-record.json","paper":"/paper/2506.09448"},"outbound":[{"citation":{"cited_paper":{"arxiv_id":"2506.09448","last_updated":"2025-06-11T06:53:40Z","snapshot_observed_at":"2026-08-07T19:22:57.303552Z","submitted_at":"2025-06-11T06:53:40Z","title":"OWSM-Biasing: Contextualizing Open Whisper-Style Speech Models for Automatic Speech Recognition with Dynamic Vocabulary","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2506.09448","snapshot_observed_at":"2026-08-07T04:53:56.912097Z","title":"These models are trained on mas- sive datasets, allowing them to generalize well across multiple domains and achieve high recognition accuracy","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2506.09448","last_updated":"2025-06-11T06:53:40Z","snapshot_observed_at":"2026-08-07T19:22:57.303552Z","submitted_at":"2025-06-11T06:53:40Z","title":"OWSM-Biasing: Contextualizing Open Whisper-Style Speech Models for Automatic Speech Recognition with Dynamic Vocabulary","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-07T04:53:56.912097Z"},"links":{"cited_paper":"/paper/2506.09448","citing_paper":"/paper/2506.09448"},"observation_digest":"sha256:5092905560e137825b58a772250dd21a488ebc46c44ef5242bcbe3d2c768d215","observation_id":"59881a6c-55b3-489f-83f4-52933688c0a6","resolution":{"observed_at":"2026-08-07T04:53:56.912097Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:54:12.897157Z","title":null,"venue":null,"work_id":"7b531dbe-898a-4fa1-9935-0d8d9617b87a","year":null},"citing_paper":{"arxiv_id":"2506.09448","last_updated":"2025-06-11T06:53:40Z","snapshot_observed_at":"2026-08-07T19:22:57.303552Z","submitted_at":"2025-06-11T06:53:40Z","title":"OWSM-Biasing: Contextualizing Open Whisper-Style Speech Models for Automatic Speech Recognition with Dynamic Vocabulary","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-07T04:53:56.999349Z"},"links":{"citing_paper":"/paper/2506.09448"},"observation_digest":"sha256:c27f8b588ef2a57b8c0adc11a4c6b7c76cc33f3d9439d8c0f1e78c2993f53d4a","observation_id":"ab025761-f535-4e25-930f-77b30ac6510c","resolution":{"observed_at":"2026-08-07T04:54:13.042152Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:54:12.609579Z","title":"all”, “ig","venue":null,"work_id":"2fe7d239-6f12-402e-b71a-592dc96cc475","year":null},"citing_paper":{"arxiv_id":"2506.09448","last_updated":"2025-06-11T06:53:40Z","snapshot_observed_at":"2026-08-07T19:22:57.303552Z","submitted_at":"2025-06-11T06:53:40Z","title":"OWSM-Biasing: Contextualizing Open Whisper-Style Speech Models for Automatic Speech Recognition with Dynamic Vocabulary","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-07T04:53:57.117525Z"},"links":{"citing_paper":"/paper/2506.09448"},"observation_digest":"sha256:afa8fb40c6e251a1f2c2e0b577f50165ef3ea74475d97ad7f44748db83a2f454","observation_id":"370cefc1-66d0-4671-8372-5328ff287ba1","resolution":{"observed_at":"2026-08-07T04:54:12.778202Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:54:12.383419Z","title":"We train the embed- ding and output layers of OWSM with vocabulary sizeKof 5,000","venue":null,"work_id":"bbba05ec-251c-4234-a187-aff9f3d1d766","year":null},"citing_paper":{"arxiv_id":"2506.09448","last_updated":"2025-06-11T06:53:40Z","snapshot_observed_at":"2026-08-07T19:22:57.303552Z","submitted_at":"2025-06-11T06:53:40Z","title":"OWSM-Biasing: Contextualizing Open Whisper-Style Speech Models for Automatic Speech Recognition with Dynamic Vocabulary","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-07T04:53:57.219539Z"},"links":{"citing_paper":"/paper/2506.09448"},"observation_digest":"sha256:115d441e01cffb96687114f106ea4668794700a853f1e7d1b68750e8c136aa33","observation_id":"a3d24052-a4c2-4205-9a00-a273612b572c","resolution":{"observed_at":"2026-08-07T04:54:12.463826Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:54:12.234006Z","title":"the” and “and","venue":null,"work_id":"01f3075c-e621-444e-9cd2-9aaf2879f15b","year":2000},"citing_paper":{"arxiv_id":"2506.09448","last_updated":"2025-06-11T06:53:40Z","snapshot_observed_at":"2026-08-07T19:22:57.303552Z","submitted_at":"2025-06-11T06:53:40Z","title":"OWSM-Biasing: Contextualizing Open Whisper-Style Speech Models for Automatic Speech Recognition with Dynamic Vocabulary","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-07T04:53:57.322370Z"},"links":{"citing_paper":"/paper/2506.09448"},"observation_digest":"sha256:88ce035f7029efc9790f4f793df8b5e5d2916ad12b56cab3cf906ab45ba0dbad","observation_id":"3a697e3a-9b89-44c3-a633-5fc9add54175","resolution":{"observed_at":"2026-08-07T04:54:12.309387Z","resolver_source":"raw_fallback","status":"malformed_identifier"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:54:12.112181Z","title":null,"venue":null,"work_id":"52b184c9-e074-4796-aeb5-f700544526c0","year":null},"citing_paper":{"arxiv_id":"2506.09448","last_updated":"2025-06-11T06:53:40Z","snapshot_observed_at":"2026-08-07T19:22:57.303552Z","submitted_at":"2025-06-11T06:53:40Z","title":"OWSM-Biasing: Contextualizing Open Whisper-Style Speech Models for Automatic Speech Recognition with Dynamic Vocabulary","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-07T04:53:57.433861Z"},"links":{"citing_paper":"/paper/2506.09448"},"observation_digest":"sha256:7534c55f6d1ad0b0b627784e6d0defc3a28aa8ae4a7dfc2c4628fce5176ac5ba","observation_id":"f86f73b0-7092-45d9-b67f-f7f5cd637c26","resolution":{"observed_at":"2026-08-07T04:54:12.161965Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:54:11.952076Z","title":"Ro- bust speech recognition via large-scale weak supervision","venue":null,"work_id":"d3cb9cf3-7721-4fde-b3ec-7d71d6a852a4","year":2022},"citing_paper":{"arxiv_id":"2506.09448","last_updated":"2025-06-11T06:53:40Z","snapshot_observed_at":"2026-08-07T19:22:57.303552Z","submitted_at":"2025-06-11T06:53:40Z","title":"OWSM-Biasing: Contextualizing Open Whisper-Style Speech Models for Automatic Speech Recognition with Dynamic Vocabulary","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-07T04:53:57.544368Z"},"links":{"citing_paper":"/paper/2506.09448"},"observation_digest":"sha256:6f41348c3a3af3b370d2348bad7c61c058cc08205c03634f7a217ca671900efd","observation_id":"b957b6df-0b3a-4e35-8947-8d3e39650e26","resolution":{"observed_at":"2026-08-07T04:54:12.039913Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:54:11.686678Z","title":"Repro- ducing Whisper-style training using an open-source toolkit and publicly available data,","venue":null,"work_id":"2dc17ad1-13f9-433c-a0d1-567a34dc28c2","year":2023},"citing_paper":{"arxiv_id":"2506.09448","last_updated":"2025-06-11T06:53:40Z","snapshot_observed_at":"2026-08-07T19:22:57.303552Z","submitted_at":"2025-06-11T06:53:40Z","title":"OWSM-Biasing: Contextualizing Open Whisper-Style Speech Models for Automatic Speech Recognition with Dynamic Vocabulary","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-07T04:53:57.673027Z"},"links":{"citing_paper":"/paper/2506.09448"},"observation_digest":"sha256:1fcd6d4de9180c2995d3f21d82e3a998d2b6dbd8d346c586a9bd0d48143e95c8","observation_id":"235a55a1-b154-43cf-9697-fe726a6a0d7a","resolution":{"observed_at":"2026-08-07T04:54:11.812242Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2303.01037","last_updated":"2023-09-25T01:20:23Z","snapshot_observed_at":"2026-08-04T01:36:29.191456Z","submitted_at":"2023-03-02T07:47:18Z","title":"Google USM: Scaling Automatic Speech Recognition Beyond 100 Languages","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2303.01037","snapshot_observed_at":"2026-08-07T04:53:57.801970Z","title":"Google USM: Scaling automatic speech recognition beyond 100 lan- guages,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.09448","last_updated":"2025-06-11T06:53:40Z","snapshot_observed_at":"2026-08-07T19:22:57.303552Z","submitted_at":"2025-06-11T06:53:40Z","title":"OWSM-Biasing: Contextualizing Open Whisper-Style Speech Models for Automatic Speech Recognition with Dynamic Vocabulary","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-07T04:53:57.801970Z"},"links":{"cited_paper":"/paper/2303.01037","citing_paper":"/paper/2506.09448"},"observation_digest":"sha256:34902a2be6da8ebc4bcd221b4c7e7f1ea0fe3c9d59bf4cfad2fbd645ebf39882","observation_id":"4f187dca-064d-4cd8-ab66-bb2d60499661","resolution":{"observed_at":"2026-08-07T04:53:57.801970Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:54:11.341576Z","title":"Scal- ing speech technology to 1,000+ languages,","venue":null,"work_id":"e879fd0b-5068-4a53-bf91-423b10aec960","year":2024},"citing_paper":{"arxiv_id":"2506.09448","last_updated":"2025-06-11T06:53:40Z","snapshot_observed_at":"2026-08-07T19:22:57.303552Z","submitted_at":"2025-06-11T06:53:40Z","title":"OWSM-Biasing: Contextualizing Open Whisper-Style Speech Models for Automatic Speech Recognition with Dynamic Vocabulary","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-07T04:53:57.953563Z"},"links":{"citing_paper":"/paper/2506.09448"},"observation_digest":"sha256:ddbe53cc28e66c2e8183d666c97636ebb1620c88ade6b63414c12485201776cf","observation_id":"826a9a5a-a245-4b2f-92e7-ac1fa68efe40","resolution":{"observed_at":"2026-08-07T04:54:11.523089Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:54:11.023844Z","title":"Less is more: Accurate speech recognition & translation without web-scale data,","venue":null,"work_id":"54baf682-8957-4175-9728-f8041c5a1ef1","year":2024},"citing_paper":{"arxiv_id":"2506.09448","last_updated":"2025-06-11T06:53:40Z","snapshot_observed_at":"2026-08-07T19:22:57.303552Z","submitted_at":"2025-06-11T06:53:40Z","title":"OWSM-Biasing: Contextualizing Open Whisper-Style Speech Models for Automatic Speech Recognition with Dynamic Vocabulary","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-07T04:53:58.111749Z"},"links":{"citing_paper":"/paper/2506.09448"},"observation_digest":"sha256:351161b5d3dd5ed8c42d9300e821d5a93115eca54ab2ca2a80d2c22f6334fed4","observation_id":"febaa2cc-4d75-417e-889f-2ff813c68001","resolution":{"observed_at":"2026-08-07T04:54:11.178196Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:54:10.826185Z","title":"OWSM-CTC: An open encoder-only speech foundation model for speech recog- nition, translation, and language identification,","venue":null,"work_id":"69f139f6-e3ad-4841-ba2c-aa705bc1ef36","year":2024},"citing_paper":{"arxiv_id":"2506.09448","last_updated":"2025-06-11T06:53:40Z","snapshot_observed_at":"2026-08-07T19:22:57.303552Z","submitted_at":"2025-06-11T06:53:40Z","title":"OWSM-Biasing: Contextualizing Open Whisper-Style Speech Models for Automatic Speech Recognition with Dynamic Vocabulary","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-07T04:53:58.207904Z"},"links":{"citing_paper":"/paper/2506.09448"},"observation_digest":"sha256:92dc67c61a7e8d4ae7c411dd75c0b16130bc7d2dbd2cda163b6dff6d41d236cb","observation_id":"6f02bc4a-7529-44ea-86d5-32f0227246d8","resolution":{"observed_at":"2026-08-07T04:54:10.945478Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:54:10.506890Z","title":"OWSM v3.1: Better and faster open Whisper-style speech models based on e- branchformer,","venue":null,"work_id":"46dbff61-91fe-48df-93d2-4d0903194342","year":2024},"citing_paper":{"arxiv_id":"2506.09448","last_updated":"2025-06-11T06:53:40Z","snapshot_observed_at":"2026-08-07T19:22:57.303552Z","submitted_at":"2025-06-11T06:53:40Z","title":"OWSM-Biasing: Contextualizing Open Whisper-Style Speech Models for Automatic Speech Recognition with Dynamic Vocabulary","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-07T04:53:58.261774Z"},"links":{"citing_paper":"/paper/2506.09448"},"observation_digest":"sha256:653dc09e73ec45cabaf2290026af319de9a14461b3df07440fd906c6fc9e5880","observation_id":"ff1dc0f1-86b6-4acd-9290-ec937acad892","resolution":{"observed_at":"2026-08-07T04:54:10.671293Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:54:10.234096Z","title":"CB-Whisper: Contex- tual biasing Whisper using open-vocabulary keyword-spotting,","venue":null,"work_id":"b8957a2d-1e42-4d33-9875-c98991a0b797","year":2024},"citing_paper":{"arxiv_id":"2506.09448","last_updated":"2025-06-11T06:53:40Z","snapshot_observed_at":"2026-08-07T19:22:57.303552Z","submitted_at":"2025-06-11T06:53:40Z","title":"OWSM-Biasing: Contextualizing Open Whisper-Style Speech Models for Automatic Speech Recognition with Dynamic Vocabulary","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-07T04:53:58.304434Z"},"links":{"citing_paper":"/paper/2506.09448"},"observation_digest":"sha256:d9161c3806ac0d7d3c1b8af9aa8a1730f77f6e143d88040921fdbb37c268b2ff","observation_id":"62cd81ba-b439-44bc-ab9a-d1ebe2345837","resolution":{"observed_at":"2026-08-07T04:54:10.364686Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:54:09.986741Z","title":"Can contex- tual biasing remain effective with Whisper and GPT-2?","venue":null,"work_id":"c20de16a-33eb-449b-bff3-0b258215a929","year":2023},"citing_paper":{"arxiv_id":"2506.09448","last_updated":"2025-06-11T06:53:40Z","snapshot_observed_at":"2026-08-07T19:22:57.303552Z","submitted_at":"2025-06-11T06:53:40Z","title":"OWSM-Biasing: Contextualizing Open Whisper-Style Speech Models for Automatic Speech Recognition with Dynamic Vocabulary","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-07T04:53:58.418507Z"},"links":{"citing_paper":"/paper/2506.09448"},"observation_digest":"sha256:79f0511cb857e17acc2719b4df540cf4acbcfc1e0aa75c2ef48de48663bb92ad","observation_id":"843c8724-e1e8-4f57-bbae-ecc6ca9e3b9e","resolution":{"observed_at":"2026-08-07T04:54:10.084534Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:54:09.704580Z","title":"Adding user feedback to enhance CB-Whisper,","venue":null,"work_id":"5bf78e13-b036-4c8b-ab3a-5e7e09aaf0b5","year":2024},"citing_paper":{"arxiv_id":"2506.09448","last_updated":"2025-06-11T06:53:40Z","snapshot_observed_at":"2026-08-07T19:22:57.303552Z","submitted_at":"2025-06-11T06:53:40Z","title":"OWSM-Biasing: Contextualizing Open Whisper-Style Speech Models for Automatic Speech Recognition with Dynamic Vocabulary","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-07T04:53:58.545879Z"},"links":{"citing_paper":"/paper/2506.09448"},"observation_digest":"sha256:04498effc5c4c740c3db8b4d22b4f39f24693d8a8452454a056c8ae8e18af857","observation_id":"93f0d36d-402a-4e37-913e-6d13d6176877","resolution":{"observed_at":"2026-08-07T04:54:09.839604Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:54:09.440212Z","title":"Contextual biasing to improve domain- specific custom vocabulary audio transcription without explicit fine-tuning of Whisper model,","venue":null,"work_id":"e9df056f-9673-40a0-9304-3517aef6aadd","year":2024},"citing_paper":{"arxiv_id":"2506.09448","last_updated":"2025-06-11T06:53:40Z","snapshot_observed_at":"2026-08-07T19:22:57.303552Z","submitted_at":"2025-06-11T06:53:40Z","title":"OWSM-Biasing: Contextualizing Open Whisper-Style Speech Models for Automatic Speech Recognition with Dynamic Vocabulary","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-07T04:53:58.696074Z"},"links":{"citing_paper":"/paper/2506.09448"},"observation_digest":"sha256:99f0b09b4ba55df18c4dc3e9d3ae3a8ee271523beb465e337cfe9d86e70e4f06","observation_id":"380983ad-aa40-40d7-bd5f-24398ac29a06","resolution":{"observed_at":"2026-08-07T04:54:09.587036Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:54:09.185413Z","title":"A multitask train- ing approach to enhance Whisper with open-vocabulary keyword spotting,","venue":null,"work_id":"15b8de0b-87ce-4c35-a0bb-22f0311016db","year":2024},"citing_paper":{"arxiv_id":"2506.09448","last_updated":"2025-06-11T06:53:40Z","snapshot_observed_at":"2026-08-07T19:22:57.303552Z","submitted_at":"2025-06-11T06:53:40Z","title":"OWSM-Biasing: Contextualizing Open Whisper-Style Speech Models for Automatic Speech Recognition with Dynamic Vocabulary","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-07T04:53:58.811210Z"},"links":{"citing_paper":"/paper/2506.09448"},"observation_digest":"sha256:305e94542cceb93bc294bd2fef73217475d4ed11c38469d6e62352e485d4c093","observation_id":"361d0375-8662-4284-a6b8-6da2f19ee3dc","resolution":{"observed_at":"2026-08-07T04:54:09.323740Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2311.07919","last_updated":"2023-12-21T10:20:42Z","snapshot_observed_at":"2026-08-07T10:17:55.688598Z","submitted_at":"2023-11-14T05:34:50Z","title":"Qwen-Audio: Advancing Universal Audio Understanding via Unified Large-Scale Audio-Language Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2311.07919","snapshot_observed_at":"2026-08-07T04:53:58.965895Z","title":"Qwen-audio: Advancing universal audio understanding via unified large-scale audio-language models,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.09448","last_updated":"2025-06-11T06:53:40Z","snapshot_observed_at":"2026-08-07T19:22:57.303552Z","submitted_at":"2025-06-11T06:53:40Z","title":"OWSM-Biasing: Contextualizing Open Whisper-Style Speech Models for Automatic Speech Recognition with Dynamic Vocabulary","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-07T04:53:58.965895Z"},"links":{"cited_paper":"/paper/2311.07919","citing_paper":"/paper/2506.09448"},"observation_digest":"sha256:09ab1d4f6e1f3f6541389e32d4dfe359ef0b3d7b3e10c88cad2a119cc7fe7158","observation_id":"dff02807-cf82-40a2-93cf-ae1d78d5bc25","resolution":{"observed_at":"2026-08-07T04:53:58.965895Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:54:08.902177Z","title":"SALMONN: Towards generic hearing abilities for large language models,","venue":null,"work_id":"eae1cc0d-746a-4784-b629-889a1e11e3e0","year":2024},"citing_paper":{"arxiv_id":"2506.09448","last_updated":"2025-06-11T06:53:40Z","snapshot_observed_at":"2026-08-07T19:22:57.303552Z","submitted_at":"2025-06-11T06:53:40Z","title":"OWSM-Biasing: Contextualizing Open Whisper-Style Speech Models for Automatic Speech Recognition with Dynamic Vocabulary","version":1},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-07T04:53:59.096100Z"},"links":{"citing_paper":"/paper/2506.09448"},"observation_digest":"sha256:9851144129ec3799946828e82bd0e9f44ebf6b783445035d8d5a029ed0a6a5b1","observation_id":"ee4f9c0d-aac5-4dab-be09-7221277096ac","resolution":{"observed_at":"2026-08-07T04:54:09.069261Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2402.08846","last_updated":"2024-02-13T23:25:04Z","snapshot_observed_at":"2026-08-06T09:11:01.697195Z","submitted_at":"2024-02-13T23:25:04Z","title":"An Embarrassingly Simple Approach for LLM with Strong ASR Capacity","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.08846","snapshot_observed_at":"2026-08-07T04:53:59.219105Z","title":"An embarrass- ingly simple approach for LLM with strong ASR capacity,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.09448","last_updated":"2025-06-11T06:53:40Z","snapshot_observed_at":"2026-08-07T19:22:57.303552Z","submitted_at":"2025-06-11T06:53:40Z","title":"OWSM-Biasing: Contextualizing Open Whisper-Style Speech Models for Automatic Speech Recognition with Dynamic Vocabulary","version":1},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-07T04:53:59.219105Z"},"links":{"cited_paper":"/paper/2402.08846","citing_paper":"/paper/2506.09448"},"observation_digest":"sha256:57e878e94e58d072486b2d55148b34e5bc392442e85a6d3eb7d7d90eba60d7c1","observation_id":"56c9aa8c-2be0-4566-b5f8-4c3940d3a695","resolution":{"observed_at":"2026-08-07T04:53:59.219105Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2410.17485","last_updated":"2025-02-07T02:08:29Z","snapshot_observed_at":"2026-08-08T23:04:48.298748Z","submitted_at":"2024-10-23T00:36:06Z","title":"VoiceTextBlender: Augmenting Large Language Models with Speech Capabilities via Single-Stage Joint Speech-Text Supervised Fine-Tuning","version":2},"cited_work":{"arxiv_id":"2410.17485","doi":null,"metadata_source":"pith","pith_arxiv_id":"2410.17485","snapshot_observed_at":"2026-08-07T04:54:03.021809Z","title":"VoiceTextBlender: Augmenting Large Language Models with Speech Capabilities via Single-Stage Joint Speech-Text Supervised Fine-Tuning","venue":"cs.CL","work_id":"11f3681f-c6d0-4e89-8de1-2e31b7d686ef","year":2024},"citing_paper":{"arxiv_id":"2506.09448","last_updated":"2025-06-11T06:53:40Z","snapshot_observed_at":"2026-08-07T19:22:57.303552Z","submitted_at":"2025-06-11T06:53:40Z","title":"OWSM-Biasing: Contextualizing Open Whisper-Style Speech Models for Automatic Speech Recognition with Dynamic Vocabulary","version":1},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-07T04:53:59.331661Z"},"links":{"cited_paper":"/paper/2410.17485","citing_paper":"/paper/2506.09448"},"observation_digest":"sha256:c1123fb15e0b309384e00af0e6d68cda290b824d3f6e8d287e0ad6b8f78a0edb","observation_id":"44cf86a3-558d-4733-aef5-f4892ad12fe8","resolution":{"observed_at":"2026-08-07T04:54:03.157702Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:54:08.651085Z","title":"Contextual biasing speech recognition in speech-enhanced large language model,","venue":null,"work_id":"21d938e9-6d97-46ff-9d0c-bc948fdd4c5a","year":2024},"citing_paper":{"arxiv_id":"2506.09448","last_updated":"2025-06-11T06:53:40Z","snapshot_observed_at":"2026-08-07T19:22:57.303552Z","submitted_at":"2025-06-11T06:53:40Z","title":"OWSM-Biasing: Contextualizing Open Whisper-Style Speech Models for Automatic Speech Recognition with Dynamic Vocabulary","version":1},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-07T04:53:59.442949Z"},"links":{"citing_paper":"/paper/2506.09448"},"observation_digest":"sha256:da4ba35ebe6ba3934dc110df1a57e1707796bd8e1d47e85f44433b42b357d642","observation_id":"a7bc907d-74be-42b0-b516-e1d1c7ac1e93","resolution":{"observed_at":"2026-08-07T04:54:08.766360Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2309.10524","last_updated":"2025-01-07T05:15:54Z","snapshot_observed_at":"2026-07-06T16:20:29.025335Z","submitted_at":"2023-09-19T11:10:50Z","title":"Harnessing the Zero-Shot Power of Instruction-Tuned Large Language Model in End-to-End Speech Recognition","version":3},"cited_work":{"arxiv_id":"2309.10524","doi":null,"metadata_source":"pith","pith_arxiv_id":"2309.10524","snapshot_observed_at":"2026-08-07T04:54:02.780295Z","title":"Harnessing the Zero-Shot Power of Instruction-Tuned Large Language Model in End-to-End Speech Recognition","venue":"eess.AS","work_id":"5aadfc25-5109-4393-b3cd-ee19c7ebb72b","year":2023},"citing_paper":{"arxiv_id":"2506.09448","last_updated":"2025-06-11T06:53:40Z","snapshot_observed_at":"2026-08-07T19:22:57.303552Z","submitted_at":"2025-06-11T06:53:40Z","title":"OWSM-Biasing: Contextualizing Open Whisper-Style Speech Models for Automatic Speech Recognition with Dynamic Vocabulary","version":1},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-07T04:53:59.566215Z"},"links":{"cited_paper":"/paper/2309.10524","citing_paper":"/paper/2506.09448"},"observation_digest":"sha256:5e482ba593aeb3b8f3bc632949003b576023e989f822ce07df0f2117e4f05ce3","observation_id":"df0ac8f8-8eb2-4b95-b881-1dfecf2c26bd","resolution":{"observed_at":"2026-08-07T04:54:02.883695Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:54:08.288947Z","title":"Deep context: End-to-end contextual speech recogni- tion,","venue":null,"work_id":"b8849b88-84d7-4b61-a545-b46f1f10f6ef","year":2018},"citing_paper":{"arxiv_id":"2506.09448","last_updated":"2025-06-11T06:53:40Z","snapshot_observed_at":"2026-08-07T19:22:57.303552Z","submitted_at":"2025-06-11T06:53:40Z","title":"OWSM-Biasing: Contextualizing Open Whisper-Style Speech Models for Automatic Speech Recognition with Dynamic Vocabulary","version":1},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-08-07T04:53:59.721060Z"},"links":{"citing_paper":"/paper/2506.09448"},"observation_digest":"sha256:407d7787ac57762263fcf5671d7c5318a33bd40c5c559a19a478f05a8faba4a3","observation_id":"8b6031f6-cf8a-45cc-ad22-f8b11d582077","resolution":{"observed_at":"2026-08-07T04:54:08.477112Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:54:08.019067Z","title":"Contextual RNN-T for open domain asr,","venue":null,"work_id":"bd8b8188-2d8b-4de4-8b42-0b1a9f19c71c","year":2020},"citing_paper":{"arxiv_id":"2506.09448","last_updated":"2025-06-11T06:53:40Z","snapshot_observed_at":"2026-08-07T19:22:57.303552Z","submitted_at":"2025-06-11T06:53:40Z","title":"OWSM-Biasing: Contextualizing Open Whisper-Style Speech Models for Automatic Speech Recognition with Dynamic Vocabulary","version":1},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-08-07T04:53:59.870856Z"},"links":{"citing_paper":"/paper/2506.09448"},"observation_digest":"sha256:8dbaff9b10952d7508ccf1e3775e2e250fda763a09066d78341a98e58e907406","observation_id":"e94d55c1-8e35-49a9-8f1c-a62c3d694fd2","resolution":{"observed_at":"2026-08-07T04:54:08.161085Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:54:07.791998Z","title":"Instant one-shot word-learning for context-specific neural sequence-to-sequence speech recognition,","venue":null,"work_id":"5dbd0fc2-682e-46d5-bc2d-13e8bc41df9d","year":2021},"citing_paper":{"arxiv_id":"2506.09448","last_updated":"2025-06-11T06:53:40Z","snapshot_observed_at":"2026-08-07T19:22:57.303552Z","submitted_at":"2025-06-11T06:53:40Z","title":"OWSM-Biasing: Contextualizing Open Whisper-Style Speech Models for Automatic Speech Recognition with Dynamic Vocabulary","version":1},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-08-07T04:53:59.983951Z"},"links":{"citing_paper":"/paper/2506.09448"},"observation_digest":"sha256:7ed46617f683d2c557e7c7782f3045f9297889bce0bc88fc6f6f1a5bbf4e7d7d","observation_id":"f026e41b-e611-4ccc-9daa-898825d39f90","resolution":{"observed_at":"2026-08-07T04:54:07.904348Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:54:07.535492Z","title":"Retraining-free customized ASR for enharmonic words based on a named-entity-aware model and phoneme similarity estimation,","venue":null,"work_id":"076f5a96-0df2-418a-b03e-efe3d94a3a1a","year":2023},"citing_paper":{"arxiv_id":"2506.09448","last_updated":"2025-06-11T06:53:40Z","snapshot_observed_at":"2026-08-07T19:22:57.303552Z","submitted_at":"2025-06-11T06:53:40Z","title":"OWSM-Biasing: Contextualizing Open Whisper-Style Speech Models for Automatic Speech Recognition with Dynamic Vocabulary","version":1},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-08-07T04:54:00.110123Z"},"links":{"citing_paper":"/paper/2506.09448"},"observation_digest":"sha256:af4c1689db5b8050adef55c9517a23f9634d5400aedf1276cc4333c89d234717","observation_id":"79c5e661-87dc-4fd3-9dd0-1c01cddb1e0c","resolution":{"observed_at":"2026-08-07T04:54:07.689145Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:54:07.277172Z","title":"Contex- tualized End-to-End Speech Recognition with Contextual Phrase Prediction Network,","venue":null,"work_id":"7f98073e-b1d5-41e2-ad77-2c49f7bba7fc","year":2023},"citing_paper":{"arxiv_id":"2506.09448","last_updated":"2025-06-11T06:53:40Z","snapshot_observed_at":"2026-08-07T19:22:57.303552Z","submitted_at":"2025-06-11T06:53:40Z","title":"OWSM-Biasing: Contextualizing Open Whisper-Style Speech Models for Automatic Speech Recognition with Dynamic Vocabulary","version":1},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-08-07T04:54:00.189159Z"},"links":{"citing_paper":"/paper/2506.09448"},"observation_digest":"sha256:8f73f1c568b5b77f4cc73ab3c41a0d5b6433377ba868877d76faed29718af79b","observation_id":"6fad5b74-ad37-4e31-8134-c10af9bf3c82","resolution":{"observed_at":"2026-08-07T04:54:07.397919Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2305.12839","last_updated":"2024-05-27T06:35:36Z","snapshot_observed_at":"2026-07-06T15:30:30.381545Z","submitted_at":"2023-05-22T09:03:11Z","title":"CopyNE: Better Contextual ASR by Copying Named Entities","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2305.12839","snapshot_observed_at":"2026-08-07T04:54:00.318717Z","title":"Copyne: Better contextual asr by copying named entities,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.09448","last_updated":"2025-06-11T06:53:40Z","snapshot_observed_at":"2026-08-07T19:22:57.303552Z","submitted_at":"2025-06-11T06:53:40Z","title":"OWSM-Biasing: Contextualizing Open Whisper-Style Speech Models for Automatic Speech Recognition with Dynamic Vocabulary","version":1},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-08-07T04:54:00.318717Z"},"links":{"cited_paper":"/paper/2305.12839","citing_paper":"/paper/2506.09448"},"observation_digest":"sha256:3b923c11d5139e7f6ae1214d37fd5cff86950bdc0fc0f21ffc1946648379decd","observation_id":"a25e54b9-02b2-42c0-8376-dcdf0c7a252a","resolution":{"observed_at":"2026-08-07T04:54:00.318717Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:54:06.996703Z","title":"Lib- rispeech: an ASR corpus based on public domain audio books,","venue":null,"work_id":"9d30f676-a10b-4cc4-b4e9-570b8699a326","year":2015},"citing_paper":{"arxiv_id":"2506.09448","last_updated":"2025-06-11T06:53:40Z","snapshot_observed_at":"2026-08-07T19:22:57.303552Z","submitted_at":"2025-06-11T06:53:40Z","title":"OWSM-Biasing: Contextualizing Open Whisper-Style Speech Models for Automatic Speech Recognition with Dynamic Vocabulary","version":1},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-08-07T04:54:00.439366Z"},"links":{"citing_paper":"/paper/2506.09448"},"observation_digest":"sha256:7ad048e36acdedd406e37709fb1c9358299291be8642f378cac42c1a51cfd63a","observation_id":"6129b83c-cf28-481e-859c-77766f5690ab","resolution":{"observed_at":"2026-08-07T04:54:07.121938Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:54:06.705572Z","title":"Contextualized end-to-end automatic speech recognition with intermediate bias- ing loss,","venue":null,"work_id":"4028aead-7551-44d6-93df-83dd45225cf5","year":2024},"citing_paper":{"arxiv_id":"2506.09448","last_updated":"2025-06-11T06:53:40Z","snapshot_observed_at":"2026-08-07T19:22:57.303552Z","submitted_at":"2025-06-11T06:53:40Z","title":"OWSM-Biasing: Contextualizing Open Whisper-Style Speech Models for Automatic Speech Recognition with Dynamic Vocabulary","version":1},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-08-07T04:54:00.566901Z"},"links":{"citing_paper":"/paper/2506.09448"},"observation_digest":"sha256:158263d1ceaf836abb9a236091a2024fe6f36cd7c87de4459e1722d75c980d40","observation_id":"fd400bce-61db-4a71-bea1-30b938aec5f9","resolution":{"observed_at":"2026-08-07T04:54:06.868816Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:54:06.467435Z","title":"Corpus of spontaneous Japanese: Its design and evaluation,","venue":null,"work_id":"6584bd5c-8552-4330-8d80-659754478f5a","year":2003},"citing_paper":{"arxiv_id":"2506.09448","last_updated":"2025-06-11T06:53:40Z","snapshot_observed_at":"2026-08-07T19:22:57.303552Z","submitted_at":"2025-06-11T06:53:40Z","title":"OWSM-Biasing: Contextualizing Open Whisper-Style Speech Models for Automatic Speech Recognition with Dynamic Vocabulary","version":1},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-08-07T04:54:00.677729Z"},"links":{"citing_paper":"/paper/2506.09448"},"observation_digest":"sha256:86d6e63ee866f91dba267e8df2de6cd4943bd316d210d2e2fd12a63d7e5f3dee","observation_id":"9e5933a4-62e5-4efa-bf61-9bc2c3e9d4ca","resolution":{"observed_at":"2026-08-07T04:54:06.575918Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:54:06.208420Z","title":"Phoneme-aware encoding for prefix-tree-based contextual ASR,","venue":null,"work_id":"72531891-1c1c-4d60-a9a0-e43f9e714275","year":2024},"citing_paper":{"arxiv_id":"2506.09448","last_updated":"2025-06-11T06:53:40Z","snapshot_observed_at":"2026-08-07T19:22:57.303552Z","submitted_at":"2025-06-11T06:53:40Z","title":"OWSM-Biasing: Contextualizing Open Whisper-Style Speech Models for Automatic Speech Recognition with Dynamic Vocabulary","version":1},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-08-07T04:54:00.835123Z"},"links":{"citing_paper":"/paper/2506.09448"},"observation_digest":"sha256:b6bddec0396b239a00829e708c2f539456fe091e607a7c9df5240214a03df2eb","observation_id":"bc1cc5f7-7aaf-41d7-b84f-94305fcf2fc8","resolution":{"observed_at":"2026-08-07T04:54:06.328980Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:54:05.937444Z","title":"Interbiasing: Boost unseen word recognition through biasing intermediate predictions,","venue":null,"work_id":"0b7c0b45-3c90-4081-a841-41a63b3a3eac","year":2024},"citing_paper":{"arxiv_id":"2506.09448","last_updated":"2025-06-11T06:53:40Z","snapshot_observed_at":"2026-08-07T19:22:57.303552Z","submitted_at":"2025-06-11T06:53:40Z","title":"OWSM-Biasing: Contextualizing Open Whisper-Style Speech Models for Automatic Speech Recognition with Dynamic Vocabulary","version":1},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-08-07T04:54:00.924739Z"},"links":{"citing_paper":"/paper/2506.09448"},"observation_digest":"sha256:bc1f21f079ba41afa8d2fa1ad2a278039fc1e1af11f39a06207af7abe7a189a5","observation_id":"67bf9620-fd0a-4c2b-af4d-f73a07c5b631","resolution":{"observed_at":"2026-08-07T04:54:06.033611Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:54:05.660858Z","title":"PromptASR for contextualized ASR with controllable style,","venue":null,"work_id":"ae16db88-468b-4955-bde5-ef7d41f313d5","year":2024},"citing_paper":{"arxiv_id":"2506.09448","last_updated":"2025-06-11T06:53:40Z","snapshot_observed_at":"2026-08-07T19:22:57.303552Z","submitted_at":"2025-06-11T06:53:40Z","title":"OWSM-Biasing: Contextualizing Open Whisper-Style Speech Models for Automatic Speech Recognition with Dynamic Vocabulary","version":1},"reference_index":36,"source":"pdf_text","source_observed_at":"2026-08-07T04:54:01.044115Z"},"links":{"citing_paper":"/paper/2506.09448"},"observation_digest":"sha256:3d748407702391b6be0e3582ee597e72af7d82a4e58533e6e86c4d8a10b2a930","observation_id":"187c9787-d8a7-4b87-aa0e-9b54b00c8276","resolution":{"observed_at":"2026-08-07T04:54:05.777584Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:54:05.362122Z","title":"Contextualized automatic speech recognition with attention- based bias phrase boosted beam search,","venue":null,"work_id":"6be48c2b-7f9e-4c78-bce7-58cc9f44edf8","year":2024},"citing_paper":{"arxiv_id":"2506.09448","last_updated":"2025-06-11T06:53:40Z","snapshot_observed_at":"2026-08-07T19:22:57.303552Z","submitted_at":"2025-06-11T06:53:40Z","title":"OWSM-Biasing: Contextualizing Open Whisper-Style Speech Models for Automatic Speech Recognition with Dynamic Vocabulary","version":1},"reference_index":37,"source":"pdf_text","source_observed_at":"2026-08-07T04:54:01.159181Z"},"links":{"citing_paper":"/paper/2506.09448"},"observation_digest":"sha256:f5495e7089dbff738bda41d7ef47ccea9a20de9e27f94b00a016555615411823","observation_id":"13922ba9-ed43-418a-8f7b-85dbc1098280","resolution":{"observed_at":"2026-08-07T04:54:05.524736Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:54:05.118839Z","title":"Improving large-scale deep biasing with phoneme features and text-only data in streaming transducer,","venue":null,"work_id":"8f5d27bc-1340-446a-8dc8-77c009d9b905","year":2023},"citing_paper":{"arxiv_id":"2506.09448","last_updated":"2025-06-11T06:53:40Z","snapshot_observed_at":"2026-08-07T19:22:57.303552Z","submitted_at":"2025-06-11T06:53:40Z","title":"OWSM-Biasing: Contextualizing Open Whisper-Style Speech Models for Automatic Speech Recognition with Dynamic Vocabulary","version":1},"reference_index":38,"source":"pdf_text","source_observed_at":"2026-08-07T04:54:01.251377Z"},"links":{"citing_paper":"/paper/2506.09448"},"observation_digest":"sha256:d101d3c850aac417f08f7144238fd60268ba083b93b793a23fc3cbe697da394b","observation_id":"9127bea1-2010-45b8-9a09-a9546f3f13bb","resolution":{"observed_at":"2026-08-07T04:54:05.220461Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:54:04.883374Z","title":"Contextualized streaming end-to-end speech recognition with trie-based deep biasing and shallow fusion,","venue":null,"work_id":"5cbdba8c-2595-4260-951b-9e2d7a928e37","year":2021},"citing_paper":{"arxiv_id":"2506.09448","last_updated":"2025-06-11T06:53:40Z","snapshot_observed_at":"2026-08-07T19:22:57.303552Z","submitted_at":"2025-06-11T06:53:40Z","title":"OWSM-Biasing: Contextualizing Open Whisper-Style Speech Models for Automatic Speech Recognition with Dynamic Vocabulary","version":1},"reference_index":39,"source":"pdf_text","source_observed_at":"2026-08-07T04:54:01.398030Z"},"links":{"citing_paper":"/paper/2506.09448"},"observation_digest":"sha256:6242af53594724ca465b09f7ce8d17fdc67a0a68e6447c4d039410fcbd3985c9","observation_id":"5b540885-d7e6-47a5-88a0-ab7c183e5c66","resolution":{"observed_at":"2026-08-07T04:54:04.996151Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:54:04.609073Z","title":"Contextualized automatic speech recognition with dynamic vo- cabulary,","venue":null,"work_id":"d67c8d64-90f9-4d1e-9278-7ec35e45e251","year":2024},"citing_paper":{"arxiv_id":"2506.09448","last_updated":"2025-06-11T06:53:40Z","snapshot_observed_at":"2026-08-07T19:22:57.303552Z","submitted_at":"2025-06-11T06:53:40Z","title":"OWSM-Biasing: Contextualizing Open Whisper-Style Speech Models for Automatic Speech Recognition with Dynamic Vocabulary","version":1},"reference_index":40,"source":"pdf_text","source_observed_at":"2026-08-07T04:54:01.600693Z"},"links":{"citing_paper":"/paper/2506.09448"},"observation_digest":"sha256:3ae3d7330773920bef371c8aca1066ab23e1d1a5992b533601adfbf161bbffd5","observation_id":"58b4ed50-3064-4d4b-8f8e-902c41579286","resolution":{"observed_at":"2026-08-07T04:54:04.694432Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:54:01.741283Z","title":"Hy- brid ctc/attention architecture for end-to-end speech recognition,","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2506.09448","last_updated":"2025-06-11T06:53:40Z","snapshot_observed_at":"2026-08-07T19:22:57.303552Z","submitted_at":"2025-06-11T06:53:40Z","title":"OWSM-Biasing: Contextualizing Open Whisper-Style Speech Models for Automatic Speech Recognition with Dynamic Vocabulary","version":1},"reference_index":41,"source":"pdf_text","source_observed_at":"2026-08-07T04:54:01.741283Z"},"links":{"citing_paper":"/paper/2506.09448"},"observation_digest":"sha256:a7e292a87c16bed41d71114378e87930dc7605621f9284679713eb6cdc485fc4","observation_id":"9256327f-826d-476e-94b3-f7c4eedec0c9","resolution":{"observed_at":"2026-08-07T04:54:01.741283Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:54:04.326476Z","title":"Time- synchronous one-pass beam search for parallel online and offline transducers with dynamic block training,","venue":null,"work_id":"75c5be3d-f65f-44a3-b655-115a876f7d04","year":2023},"citing_paper":{"arxiv_id":"2506.09448","last_updated":"2025-06-11T06:53:40Z","snapshot_observed_at":"2026-08-07T19:22:57.303552Z","submitted_at":"2025-06-11T06:53:40Z","title":"OWSM-Biasing: Contextualizing Open Whisper-Style Speech Models for Automatic Speech Recognition with Dynamic Vocabulary","version":1},"reference_index":42,"source":"pdf_text","source_observed_at":"2026-08-07T04:54:01.877231Z"},"links":{"citing_paper":"/paper/2506.09448"},"observation_digest":"sha256:bf885d68aa96e5290d7c1b16db02c3d5f743d4ec277d6abcae453ce72feeee7b","observation_id":"d013093b-5684-4afd-b11d-159cf326c5da","resolution":{"observed_at":"2026-08-07T04:54:04.448388Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:54:04.044668Z","title":"Joint beam search integrating ctc, attention, and transducer decoders,","venue":null,"work_id":"3dd5129d-f115-447a-8030-475574c5d3ff","year":2025},"citing_paper":{"arxiv_id":"2506.09448","last_updated":"2025-06-11T06:53:40Z","snapshot_observed_at":"2026-08-07T19:22:57.303552Z","submitted_at":"2025-06-11T06:53:40Z","title":"OWSM-Biasing: Contextualizing Open Whisper-Style Speech Models for Automatic Speech Recognition with Dynamic Vocabulary","version":1},"reference_index":43,"source":"pdf_text","source_observed_at":"2026-08-07T04:54:02.007470Z"},"links":{"citing_paper":"/paper/2506.09448"},"observation_digest":"sha256:b4599bb56471a951e71963f956f00bc7137b42ccdeaef3c815dde29a31840045","observation_id":"af9f1496-d3b5-44dd-943e-f797cc60d2a4","resolution":{"observed_at":"2026-08-07T04:54:04.152176Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:54:03.834072Z","title":"E-Branchformer: Branchformer with enhanced merging for speech recognition,","venue":null,"work_id":"a68c080c-bb5a-4105-91c7-eae866fa68bf","year":2023},"citing_paper":{"arxiv_id":"2506.09448","last_updated":"2025-06-11T06:53:40Z","snapshot_observed_at":"2026-08-07T19:22:57.303552Z","submitted_at":"2025-06-11T06:53:40Z","title":"OWSM-Biasing: Contextualizing Open Whisper-Style Speech Models for Automatic Speech Recognition with Dynamic Vocabulary","version":1},"reference_index":44,"source":"pdf_text","source_observed_at":"2026-08-07T04:54:02.141841Z"},"links":{"citing_paper":"/paper/2506.09448"},"observation_digest":"sha256:6ea1117b1c88c4dfdb9082d17970277e6f162e1c5f8f892ba69c617b50bf6023","observation_id":"cd5e6539-0cde-4a56-a05d-a37e60ffa3c0","resolution":{"observed_at":"2026-08-07T04:54:03.930476Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:54:03.617497Z","title":"Attention is all you need,","venue":null,"work_id":"f13bc0c5-580f-4610-9c88-ba9a6bb26dfe","year":2017},"citing_paper":{"arxiv_id":"2506.09448","last_updated":"2025-06-11T06:53:40Z","snapshot_observed_at":"2026-08-07T19:22:57.303552Z","submitted_at":"2025-06-11T06:53:40Z","title":"OWSM-Biasing: Contextualizing Open Whisper-Style Speech Models for Automatic Speech Recognition with Dynamic Vocabulary","version":1},"reference_index":45,"source":"pdf_text","source_observed_at":"2026-08-07T04:54:02.297436Z"},"links":{"citing_paper":"/paper/2506.09448"},"observation_digest":"sha256:7f1dceb07997ef7741fb08442bca9080754073f4c8e34c5f2715e64af7ce0d88","observation_id":"7e0949b4-2891-443d-9a4a-7c8a1e5c4c43","resolution":{"observed_at":"2026-08-07T04:54:03.710031Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:54:02.462065Z","title":"Adam: A method for stochastic opti- mization,","venue":null,"work_id":null,"year":2015},"citing_paper":{"arxiv_id":"2506.09448","last_updated":"2025-06-11T06:53:40Z","snapshot_observed_at":"2026-08-07T19:22:57.303552Z","submitted_at":"2025-06-11T06:53:40Z","title":"OWSM-Biasing: Contextualizing Open Whisper-Style Speech Models for Automatic Speech Recognition with Dynamic Vocabulary","version":1},"reference_index":46,"source":"pdf_text","source_observed_at":"2026-08-07T04:54:02.462065Z"},"links":{"citing_paper":"/paper/2506.09448"},"observation_digest":"sha256:937e8ffb1cb2c0a5ca641d3020459facbab9134ac84b8668d43c8916249dd1e0","observation_id":"b281a407-237d-4dab-b7b8-218de9fb78e3","resolution":{"observed_at":"2026-08-07T04:54:02.462065Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:54:03.361205Z","title":"ESPnet: End-to-end speech processing toolkit,","venue":null,"work_id":"c1c6ef93-1a43-4f42-a870-09740a8ac008","year":2018},"citing_paper":{"arxiv_id":"2506.09448","last_updated":"2025-06-11T06:53:40Z","snapshot_observed_at":"2026-08-07T19:22:57.303552Z","submitted_at":"2025-06-11T06:53:40Z","title":"OWSM-Biasing: Contextualizing Open Whisper-Style Speech Models for Automatic Speech Recognition with Dynamic Vocabulary","version":1},"reference_index":47,"source":"pdf_text","source_observed_at":"2026-08-07T04:54:02.600982Z"},"links":{"citing_paper":"/paper/2506.09448"},"observation_digest":"sha256:aaab7f10ab03416f53a2d677b65eb3a7014b9a2de11ad37a0cbc318d466475f9","observation_id":"56f76f15-2638-4ca3-927f-e1c7d519c1a1","resolution":{"observed_at":"2026-08-07T04:54:03.491927Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}}],"paper":{"arxiv_id":"2506.09448","last_updated":"2025-06-11T06:53:40Z","latest_version":1,"primary_category":"cs.SD","snapshot_observed_at":"2026-08-07T19:22:57.303552Z","submitted_at":"2025-06-11T06:53:40Z","title":"OWSM-Biasing: Contextualizing Open Whisper-Style Speech Models for Automatic Speech Recognition with Dynamic Vocabulary"},"reference_resolution":{"displayed":47,"state_counts":{"malformed_identifier":1,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":9,"verified_exact":2,"verified_fuzzy":35},"total_outbound_references":47},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"thesis":"As of 9 August 2026, this Paper Citation Record lists 47 of 47 outbound references and 2 inbound Pith citation observations for arXiv:2506.09448."}