{"as_of":"2026-08-20T03:28:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:1be0d2f377d9926aec6caf759f534a929c5f5c69687c29ce2a9dc264f87319dd","coverage":[{"denominator":34,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":34,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-07T15:10:51.525953Z","state":"measured"},{"denominator":35,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":35,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-19T06:32:44.657259+00:00","state":"measured"},{"denominator":1,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":1,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-07T15:10:48.894279Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"pith","source_observed_at":"2026-08-07T15:10:51.736215Z","state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2505.16168","last_updated":"2025-05-22T03:13:40Z","snapshot_observed_at":"2026-08-11T21:52:54.745729Z","submitted_at":"2025-05-22T03:13:40Z","title":"Selective Invocation for Multilingual ASR: A Cost-effective Approach Adapting to Speech Recognition Difficulty","version":1},"cited_work":{"arxiv_id":"2505.16168","doi":null,"metadata_source":"pith","pith_arxiv_id":"2505.16168","snapshot_observed_at":"2026-08-07T15:10:51.736215Z","title":"Selective Invocation for Multilingual ASR: A Cost-effective Approach Adapting to Speech Recognition Difficulty","venue":"cs.SD","work_id":"f2c0ab49-0c5a-4a3d-9610-d7cca0c6777f","year":2025},"citing_paper":{"arxiv_id":"2505.16168","last_updated":"2025-05-22T03:13:40Z","snapshot_observed_at":"2026-08-11T21:52:54.745729Z","submitted_at":"2025-05-22T03:13:40Z","title":"Selective Invocation for Multilingual ASR: A Cost-effective Approach Adapting to Speech Recognition Difficulty","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-07T15:10:48.894279Z"},"links":{"cited_paper":"/paper/2505.16168","citing_paper":"/paper/2505.16168"},"observation_digest":"sha256:12b7e6a5b54b197ce375e23c3a8759b175390826b6beb7f7b7bcdddee9f011c3","observation_id":"8ee41a53-2c81-45d6-ac91-fcda845a5405","resolution":{"observed_at":"2026-08-07T15:10:51.764906Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}}],"links":{"evidence":"/evidence","html":"/paper/2505.16168/citation-record","integrity":"/paper/2505.16168/integrity","json":"/paper/2505.16168/citation-record.json","paper":"/paper/2505.16168"},"outbound":[{"citation":{"cited_paper":{"arxiv_id":"2505.16168","last_updated":"2025-05-22T03:13:40Z","snapshot_observed_at":"2026-08-11T21:52:54.745729Z","submitted_at":"2025-05-22T03:13:40Z","title":"Selective Invocation for Multilingual ASR: A Cost-effective Approach Adapting to Speech Recognition Difficulty","version":1},"cited_work":{"arxiv_id":"2505.16168","doi":null,"metadata_source":"pith","pith_arxiv_id":"2505.16168","snapshot_observed_at":"2026-08-07T15:10:51.736215Z","title":"Selective Invocation for Multilingual ASR: A Cost-effective Approach Adapting to Speech Recognition Difficulty","venue":"cs.SD","work_id":"f2c0ab49-0c5a-4a3d-9610-d7cca0c6777f","year":2025},"citing_paper":{"arxiv_id":"2505.16168","last_updated":"2025-05-22T03:13:40Z","snapshot_observed_at":"2026-08-11T21:52:54.745729Z","submitted_at":"2025-05-22T03:13:40Z","title":"Selective Invocation for Multilingual ASR: A Cost-effective Approach Adapting to Speech Recognition Difficulty","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-07T15:10:48.894279Z"},"links":{"cited_paper":"/paper/2505.16168","citing_paper":"/paper/2505.16168"},"observation_digest":"sha256:12b7e6a5b54b197ce375e23c3a8759b175390826b6beb7f7b7bcdddee9f011c3","observation_id":"8ee41a53-2c81-45d6-ac91-fcda845a5405","resolution":{"observed_at":"2026-08-07T15:10:51.764906Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:10:54.410937Z","title":"Invoca- tion No","venue":null,"work_id":"7f76d9bc-7ef4-4d94-86a3-f8c1038d47dc","year":null},"citing_paper":{"arxiv_id":"2505.16168","last_updated":"2025-05-22T03:13:40Z","snapshot_observed_at":"2026-08-11T21:52:54.745729Z","submitted_at":"2025-05-22T03:13:40Z","title":"Selective Invocation for Multilingual ASR: A Cost-effective Approach Adapting to Speech Recognition Difficulty","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-07T15:10:48.961899Z"},"links":{"citing_paper":"/paper/2505.16168"},"observation_digest":"sha256:96b3da48c6722c2ce1472e3618de25685c6289b37a328b45194e668d3cebcdd6","observation_id":"ab22dbc8-387b-40ed-bc55-6a339007614c","resolution":{"observed_at":"2026-08-07T15:10:54.462147Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:10:54.312854Z","title":"Uncertain","venue":null,"work_id":"5597c314-3a3b-40a9-9b70-6cee32da6a4b","year":null},"citing_paper":{"arxiv_id":"2505.16168","last_updated":"2025-05-22T03:13:40Z","snapshot_observed_at":"2026-08-11T21:52:54.745729Z","submitted_at":"2025-05-22T03:13:40Z","title":"Selective Invocation for Multilingual ASR: A Cost-effective Approach Adapting to Speech Recognition Difficulty","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-07T15:10:49.059179Z"},"links":{"citing_paper":"/paper/2505.16168"},"observation_digest":"sha256:62e5dea46f3cf3a383332cbf17892f06ae500b0c76e9b0dfdcd7e2328e36ab33","observation_id":"fead3a66-ea5e-47f9-8f00-cc52aff07202","resolution":{"observed_at":"2026-08-07T15:10:54.362733Z","resolver_source":"raw_fallback","status":"malformed_identifier"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:10:54.093970Z","title":"Leveraging a base spoken large lan- guage model, SIMA dynamically determines whether to tran- scribe speech directly or invoke specialized SOTA models","venue":null,"work_id":"e111f03f-2fcc-420f-b60c-81b3b275acde","year":null},"citing_paper":{"arxiv_id":"2505.16168","last_updated":"2025-05-22T03:13:40Z","snapshot_observed_at":"2026-08-11T21:52:54.745729Z","submitted_at":"2025-05-22T03:13:40Z","title":"Selective Invocation for Multilingual ASR: A Cost-effective Approach Adapting to Speech Recognition Difficulty","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-07T15:10:49.139383Z"},"links":{"citing_paper":"/paper/2505.16168"},"observation_digest":"sha256:909674b16b15b7563030248f0f3d67085f6cf959b60f3f354838587013cba27a","observation_id":"4e77409c-3e7b-4527-b1c4-e92593824679","resolution":{"observed_at":"2026-08-07T15:10:54.199507Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:10:53.900116Z","title":"Multilingual speech recognition with a single end-to-end model,","venue":null,"work_id":"3b0d98f6-6a4b-4d58-929e-5400282869f8","year":2018},"citing_paper":{"arxiv_id":"2505.16168","last_updated":"2025-05-22T03:13:40Z","snapshot_observed_at":"2026-08-11T21:52:54.745729Z","submitted_at":"2025-05-22T03:13:40Z","title":"Selective Invocation for Multilingual ASR: A Cost-effective Approach Adapting to Speech Recognition Difficulty","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-07T15:10:49.252713Z"},"links":{"citing_paper":"/paper/2505.16168"},"observation_digest":"sha256:41575848131cb27fcb56a6fb3cf162c5509efd2b5c58008ac04bd6ed2c27257d","observation_id":"dd917b33-7b78-4da4-b08c-d0bdb588085a","resolution":{"observed_at":"2026-08-07T15:10:54.009014Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:10:53.706895Z","title":"Cross-lingual language model pre- training,","venue":null,"work_id":"dad3e248-aa81-4ca4-b411-14e6c1659539","year":2019},"citing_paper":{"arxiv_id":"2505.16168","last_updated":"2025-05-22T03:13:40Z","snapshot_observed_at":"2026-08-11T21:52:54.745729Z","submitted_at":"2025-05-22T03:13:40Z","title":"Selective Invocation for Multilingual ASR: A Cost-effective Approach Adapting to Speech Recognition Difficulty","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-07T15:10:49.321149Z"},"links":{"citing_paper":"/paper/2505.16168"},"observation_digest":"sha256:ca652af1b7b5facea3cc848fa65f316c87bbc4348d770a178df8d7819723249c","observation_id":"635250f3-9361-4ac2-b5a3-57c7ca0430a9","resolution":{"observed_at":"2026-08-07T15:10:53.796090Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:10:53.573362Z","title":"Unsupervised cross-lingual representation learning for speech recognition,","venue":null,"work_id":"5fc1a131-327a-4fca-8f26-26fc976d3b87","year":2021},"citing_paper":{"arxiv_id":"2505.16168","last_updated":"2025-05-22T03:13:40Z","snapshot_observed_at":"2026-08-11T21:52:54.745729Z","submitted_at":"2025-05-22T03:13:40Z","title":"Selective Invocation for Multilingual ASR: A Cost-effective Approach Adapting to Speech Recognition Difficulty","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-07T15:10:49.413537Z"},"links":{"citing_paper":"/paper/2505.16168"},"observation_digest":"sha256:9c53072d11d0de38ecc28dfa182cb5d9b2ee12a8895f11e56fc0c866038d4215","observation_id":"b2e0ae20-85b0-4690-920e-d63fc598dff2","resolution":{"observed_at":"2026-08-07T15:10:53.618795Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:10:53.416136Z","title":"ML- SUPERB: multilingual speech universal performance bench- mark,","venue":null,"work_id":"97db00cb-b60d-491c-9b43-d0c0dca1e75b","year":2023},"citing_paper":{"arxiv_id":"2505.16168","last_updated":"2025-05-22T03:13:40Z","snapshot_observed_at":"2026-08-11T21:52:54.745729Z","submitted_at":"2025-05-22T03:13:40Z","title":"Selective Invocation for Multilingual ASR: A Cost-effective Approach Adapting to Speech Recognition Difficulty","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-07T15:10:49.514225Z"},"links":{"citing_paper":"/paper/2505.16168"},"observation_digest":"sha256:adbaefb0813e3c144ee95318824a18c08721e9bec117c5b34b077539c7eb022d","observation_id":"e3832067-afd7-49c0-92c7-3e76b1885975","resolution":{"observed_at":"2026-08-07T15:10:53.480308Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:10:53.285827Z","title":"Joint unsupervised and supervised training for multilingual ASR,","venue":null,"work_id":"98cc4d6f-29d5-4602-83f0-0f07a1e48c7b","year":2022},"citing_paper":{"arxiv_id":"2505.16168","last_updated":"2025-05-22T03:13:40Z","snapshot_observed_at":"2026-08-11T21:52:54.745729Z","submitted_at":"2025-05-22T03:13:40Z","title":"Selective Invocation for Multilingual ASR: A Cost-effective Approach Adapting to Speech Recognition Difficulty","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-07T15:10:49.582316Z"},"links":{"citing_paper":"/paper/2505.16168"},"observation_digest":"sha256:3429209f739ab0a6be3b16d24fe7ed897780291d8c4aed48b6246e15fbe94dc8","observation_id":"02823c8f-5fae-4e2d-b62c-9b1e45737132","resolution":{"observed_at":"2026-08-07T15:10:53.342802Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:10:53.146508Z","title":"Robust speech recognition via large-scale weak supervision,","venue":null,"work_id":"2206a5f7-357d-4945-86ec-8de7b95d7ee1","year":2023},"citing_paper":{"arxiv_id":"2505.16168","last_updated":"2025-05-22T03:13:40Z","snapshot_observed_at":"2026-08-11T21:52:54.745729Z","submitted_at":"2025-05-22T03:13:40Z","title":"Selective Invocation for Multilingual ASR: A Cost-effective Approach Adapting to Speech Recognition Difficulty","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-07T15:10:49.674771Z"},"links":{"citing_paper":"/paper/2505.16168"},"observation_digest":"sha256:413f6f38d50b801cc9fd0ef345a0bf65ed7dfeb5f90b03dd3ff166985b4dc9a6","observation_id":"5e2abe37-2c39-4dc3-beeb-c846c861115c","resolution":{"observed_at":"2026-08-07T15:10:53.217058Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:10:53.028796Z","title":"TranUSR: Phoneme-to-word Transcoder Based Unified Speech Representa- tion Learning for Cross-lingual Speech Recognition,","venue":null,"work_id":"e8bc535f-237c-4541-8539-a93de42e2a42","year":2023},"citing_paper":{"arxiv_id":"2505.16168","last_updated":"2025-05-22T03:13:40Z","snapshot_observed_at":"2026-08-11T21:52:54.745729Z","submitted_at":"2025-05-22T03:13:40Z","title":"Selective Invocation for Multilingual ASR: A Cost-effective Approach Adapting to Speech Recognition Difficulty","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-07T15:10:49.755470Z"},"links":{"citing_paper":"/paper/2505.16168"},"observation_digest":"sha256:ed0bfcd86fdd74c3813dffbc587d975b9891c1dfef0d6ce722cb5d70fff3dc3b","observation_id":"1c9242c5-b1f6-46bd-847b-83a15bcaeb22","resolution":{"observed_at":"2026-08-07T15:10:53.065505Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:10:49.853701Z","title":"Scaling speech technology to 1, 000+ languages,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.16168","last_updated":"2025-05-22T03:13:40Z","snapshot_observed_at":"2026-08-11T21:52:54.745729Z","submitted_at":"2025-05-22T03:13:40Z","title":"Selective Invocation for Multilingual ASR: A Cost-effective Approach Adapting to Speech Recognition Difficulty","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-07T15:10:49.853701Z"},"links":{"citing_paper":"/paper/2505.16168"},"observation_digest":"sha256:0289cf7aadb782e6870d1f428d82c15263b7c209512d7af5e6595a0035fb8a72","observation_id":"95943178-5c95-4853-bba4-e657cfbfea59","resolution":{"observed_at":"2026-08-07T15:10:49.853701Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2303.01037","last_updated":"2023-09-25T01:20:23Z","snapshot_observed_at":"2026-08-16T15:51:28.593814Z","submitted_at":"2023-03-02T07:47:18Z","title":"Google USM: Scaling Automatic Speech Recognition Beyond 100 Languages","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2303.01037","snapshot_observed_at":"2026-08-07T15:10:49.929741Z","title":"Google usm: Scaling auto- matic speech recognition beyond 100 languages,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.16168","last_updated":"2025-05-22T03:13:40Z","snapshot_observed_at":"2026-08-11T21:52:54.745729Z","submitted_at":"2025-05-22T03:13:40Z","title":"Selective Invocation for Multilingual ASR: A Cost-effective Approach Adapting to Speech Recognition Difficulty","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-07T15:10:49.929741Z"},"links":{"cited_paper":"/paper/2303.01037","citing_paper":"/paper/2505.16168"},"observation_digest":"sha256:a5fa78389120f00da1086ce350940732940903c5a000e919187ae0e55308c250","observation_id":"ec704d4a-f35c-42d3-87e9-b3517eb435d4","resolution":{"observed_at":"2026-08-07T15:10:49.929741Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2308.11596","last_updated":"2023-10-25T03:52:07Z","snapshot_observed_at":"2026-08-16T15:06:35.991757Z","submitted_at":"2023-08-22T17:44:18Z","title":"SeamlessM4T: Massively Multilingual & Multimodal Machine Translation","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2308.11596","snapshot_observed_at":"2026-08-07T15:10:50.018019Z","title":"Seamlessm4t-massively multilingual & multimodal ma- chine translation,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.16168","last_updated":"2025-05-22T03:13:40Z","snapshot_observed_at":"2026-08-11T21:52:54.745729Z","submitted_at":"2025-05-22T03:13:40Z","title":"Selective Invocation for Multilingual ASR: A Cost-effective Approach Adapting to Speech Recognition Difficulty","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-07T15:10:50.018019Z"},"links":{"cited_paper":"/paper/2308.11596","citing_paper":"/paper/2505.16168"},"observation_digest":"sha256:1c803b81f06afc9233fb673df6a31e0716277070063af50c8b18902a260feac3","observation_id":"ce86b745-3fa2-40b0-a3e4-35bf0274cf1f","resolution":{"observed_at":"2026-08-07T15:10:50.018019Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:10:52.943693Z","title":"SSHR: leveraging self-supervised hierarchical representations for multi- lingual automatic speech recognition,","venue":null,"work_id":"fbaa6ed0-7b0c-4c16-8ba8-ffb6f3d9e48f","year":2024},"citing_paper":{"arxiv_id":"2505.16168","last_updated":"2025-05-22T03:13:40Z","snapshot_observed_at":"2026-08-11T21:52:54.745729Z","submitted_at":"2025-05-22T03:13:40Z","title":"Selective Invocation for Multilingual ASR: A Cost-effective Approach Adapting to Speech Recognition Difficulty","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-07T15:10:50.106246Z"},"links":{"citing_paper":"/paper/2505.16168"},"observation_digest":"sha256:bb5c689e8691ec3fe24aded60b1e601c60059d3a52b8e531fdd10595130501e2","observation_id":"66ccf405-d7e2-471f-8d72-084fd19a614d","resolution":{"observed_at":"2026-08-07T15:10:52.991999Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2404.09841","last_updated":"2024-04-16T14:55:13Z","snapshot_observed_at":"2026-08-16T14:00:48.202348Z","submitted_at":"2024-04-15T14:48:43Z","title":"Anatomy of Industrial Scale Multilingual ASR","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2404.09841","snapshot_observed_at":"2026-08-07T15:10:50.185658Z","title":"Anatomy of industrial scale multilingual ASR,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.16168","last_updated":"2025-05-22T03:13:40Z","snapshot_observed_at":"2026-08-11T21:52:54.745729Z","submitted_at":"2025-05-22T03:13:40Z","title":"Selective Invocation for Multilingual ASR: A Cost-effective Approach Adapting to Speech Recognition Difficulty","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-07T15:10:50.185658Z"},"links":{"cited_paper":"/paper/2404.09841","citing_paper":"/paper/2505.16168"},"observation_digest":"sha256:ecf13b68443c1f11616879fc9415a380376fe3799e60ef482b0e5c4344f8df42","observation_id":"68bdb610-ec19-470f-9261-70f881053fd7","resolution":{"observed_at":"2026-08-07T15:10:50.185658Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:10:52.833410Z","title":"Improving multilingual asr robustness to errors in language in- put,","venue":null,"work_id":"3b90f323-e349-491b-b036-fed885140734","year":2024},"citing_paper":{"arxiv_id":"2505.16168","last_updated":"2025-05-22T03:13:40Z","snapshot_observed_at":"2026-08-11T21:52:54.745729Z","submitted_at":"2025-05-22T03:13:40Z","title":"Selective Invocation for Multilingual ASR: A Cost-effective Approach Adapting to Speech Recognition Difficulty","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-07T15:10:50.269975Z"},"links":{"citing_paper":"/paper/2505.16168"},"observation_digest":"sha256:3ba9a1b9334e961aad6be18eb9a799120cf66434329eadc12e4414aa39cea509","observation_id":"36ebdfdb-0838-4028-8bc6-0ef4febd8919","resolution":{"observed_at":"2026-08-07T15:10:52.877653Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:10:52.729079Z","title":"Recurrent neural networks for noise reduction in robust ASR,","venue":null,"work_id":"6afde795-68f1-47ee-ad94-cdf24e5809bc","year":2012},"citing_paper":{"arxiv_id":"2505.16168","last_updated":"2025-05-22T03:13:40Z","snapshot_observed_at":"2026-08-11T21:52:54.745729Z","submitted_at":"2025-05-22T03:13:40Z","title":"Selective Invocation for Multilingual ASR: A Cost-effective Approach Adapting to Speech Recognition Difficulty","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-07T15:10:50.361214Z"},"links":{"citing_paper":"/paper/2505.16168"},"observation_digest":"sha256:df36cc6cc73481f067f4f3e21ed5d6b161fad0de82c939abea31c611e086affd","observation_id":"856ff8f9-4ee4-49c0-bd34-27fa7e27a70a","resolution":{"observed_at":"2026-08-07T15:10:52.761316Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1510.08484","last_updated":"2015-10-28T20:59:04Z","snapshot_observed_at":"2026-08-18T07:31:38.105834Z","submitted_at":"2015-10-28T20:59:04Z","title":"MUSAN: A Music, Speech, and Noise Corpus","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1510.08484","snapshot_observed_at":"2026-08-07T15:10:50.447566Z","title":"MUSAN: A music, speech, and noise corpus,","venue":null,"work_id":null,"year":2015},"citing_paper":{"arxiv_id":"2505.16168","last_updated":"2025-05-22T03:13:40Z","snapshot_observed_at":"2026-08-11T21:52:54.745729Z","submitted_at":"2025-05-22T03:13:40Z","title":"Selective Invocation for Multilingual ASR: A Cost-effective Approach Adapting to Speech Recognition Difficulty","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-07T15:10:50.447566Z"},"links":{"cited_paper":"/paper/1510.08484","citing_paper":"/paper/2505.16168"},"observation_digest":"sha256:53533ec6f46401fae587d5441ebbbaf72f3e547bfad2b865c45867232e1720ff","observation_id":"146e5fe1-949e-46ea-b40c-19aadd69d117","resolution":{"observed_at":"2026-08-07T15:10:50.447566Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:10:52.622978Z","title":"Wavlm: Large- scale self-supervised pre-training for full stack speech process- ing,","venue":null,"work_id":"3a19d2d4-1d7a-49e8-8e14-4e5b957daa42","year":2022},"citing_paper":{"arxiv_id":"2505.16168","last_updated":"2025-05-22T03:13:40Z","snapshot_observed_at":"2026-08-11T21:52:54.745729Z","submitted_at":"2025-05-22T03:13:40Z","title":"Selective Invocation for Multilingual ASR: A Cost-effective Approach Adapting to Speech Recognition Difficulty","version":1},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-07T15:10:50.531433Z"},"links":{"citing_paper":"/paper/2505.16168"},"observation_digest":"sha256:b1d6e2526cea7506937271930cb1777200b851956911c483c3c65a4f1997121e","observation_id":"e8c08fbe-19d3-4182-98ce-6ebe86135c3e","resolution":{"observed_at":"2026-08-07T15:10:52.680502Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:10:52.522467Z","title":"Noise robust automatic speech recognition: review and analysis,","venue":null,"work_id":"756f5a62-2088-47a0-b4a6-c9c1e9d02175","year":2023},"citing_paper":{"arxiv_id":"2505.16168","last_updated":"2025-05-22T03:13:40Z","snapshot_observed_at":"2026-08-11T21:52:54.745729Z","submitted_at":"2025-05-22T03:13:40Z","title":"Selective Invocation for Multilingual ASR: A Cost-effective Approach Adapting to Speech Recognition Difficulty","version":1},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-07T15:10:50.635905Z"},"links":{"citing_paper":"/paper/2505.16168"},"observation_digest":"sha256:caf17250bb744386ac5a1e98dcf3aed4bd4aa8b0dfb3e15d388fb60a91fdcbfa","observation_id":"8d23be2d-4729-4a59-a567-b03eb1cd6caa","resolution":{"observed_at":"2026-08-07T15:10:52.567397Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2302.13971","last_updated":"2023-02-27T17:11:15Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2023-02-27T17:11:15Z","title":"LLaMA: Open and Efficient Foundation Language Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2302.13971","snapshot_observed_at":"2026-08-07T15:10:50.695453Z","title":"Llama: Open and efficient foundation language models,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.16168","last_updated":"2025-05-22T03:13:40Z","snapshot_observed_at":"2026-08-11T21:52:54.745729Z","submitted_at":"2025-05-22T03:13:40Z","title":"Selective Invocation for Multilingual ASR: A Cost-effective Approach Adapting to Speech Recognition Difficulty","version":1},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-07T15:10:50.695453Z"},"links":{"cited_paper":"/paper/2302.13971","citing_paper":"/paper/2505.16168"},"observation_digest":"sha256:d4cae44400b2e47ca65ad21df7577e53f9fbb40d23c1b17d9a771dfbf789cd14","observation_id":"5b236039-b9a9-4665-92a5-70128b65ecc0","resolution":{"observed_at":"2026-08-07T15:10:50.695453Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2309.16609","last_updated":"2023-09-28T17:07:49Z","snapshot_observed_at":"2026-08-09T21:25:20.369782Z","submitted_at":"2023-09-28T17:07:49Z","title":"Qwen Technical Report","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2309.16609","snapshot_observed_at":"2026-08-07T15:10:50.761636Z","title":"Qwen technical report,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.16168","last_updated":"2025-05-22T03:13:40Z","snapshot_observed_at":"2026-08-11T21:52:54.745729Z","submitted_at":"2025-05-22T03:13:40Z","title":"Selective Invocation for Multilingual ASR: A Cost-effective Approach Adapting to Speech Recognition Difficulty","version":1},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-07T15:10:50.761636Z"},"links":{"cited_paper":"/paper/2309.16609","citing_paper":"/paper/2505.16168"},"observation_digest":"sha256:99b3ba1011488d56dc5dc8c158b75470ddbaa2b8b082001dc3aad66bbd789e5c","observation_id":"9ec44209-9cef-47d8-b9e8-77cdf91f8b08","resolution":{"observed_at":"2026-08-07T15:10:50.761636Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2308.11276","last_updated":"2023-08-22T08:43:33Z","snapshot_observed_at":"2026-08-17T14:11:28.839777Z","submitted_at":"2023-08-22T08:43:33Z","title":"Music Understanding LLaMA: Advancing Text-to-Music Generation with Question Answering and Captioning","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2308.11276","snapshot_observed_at":"2026-08-07T15:10:50.833666Z","title":"Gpt-4 technical report,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.16168","last_updated":"2025-05-22T03:13:40Z","snapshot_observed_at":"2026-08-11T21:52:54.745729Z","submitted_at":"2025-05-22T03:13:40Z","title":"Selective Invocation for Multilingual ASR: A Cost-effective Approach Adapting to Speech Recognition Difficulty","version":1},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-07T15:10:50.833666Z"},"links":{"cited_paper":"/paper/2308.11276","citing_paper":"/paper/2505.16168"},"observation_digest":"sha256:0d98f26ad42bdc74408189f69aed59afa188231f66c972410537b2814810173d","observation_id":"4ce729e8-0eca-4eeb-ae67-420324ba854c","resolution":{"observed_at":"2026-08-07T15:10:50.833666Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:10:52.421163Z","title":"On decoder-only architecture for speech-to-text and large language model integration,","venue":null,"work_id":"6fc6f2ae-a2ac-4800-a6b7-377cf3bf72d5","year":2023},"citing_paper":{"arxiv_id":"2505.16168","last_updated":"2025-05-22T03:13:40Z","snapshot_observed_at":"2026-08-11T21:52:54.745729Z","submitted_at":"2025-05-22T03:13:40Z","title":"Selective Invocation for Multilingual ASR: A Cost-effective Approach Adapting to Speech Recognition Difficulty","version":1},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-08-07T15:10:50.904186Z"},"links":{"citing_paper":"/paper/2505.16168"},"observation_digest":"sha256:3d67a1ff6671911d621f6812db404de5376bb85e4cafa3898f9c64c507c78497","observation_id":"1751f849-f5b9-487c-87d7-47f2094d9247","resolution":{"observed_at":"2026-08-07T15:10:52.474466Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2311.07919","last_updated":"2023-12-21T10:20:42Z","snapshot_observed_at":"2026-08-07T10:17:55.688598Z","submitted_at":"2023-11-14T05:34:50Z","title":"Qwen-Audio: Advancing Universal Audio Understanding via Unified Large-Scale Audio-Language Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2311.07919","snapshot_observed_at":"2026-08-07T15:10:50.982722Z","title":"Qwen-audio: Advancing universal audio understand- ing via unified large-scale audio-language models,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.16168","last_updated":"2025-05-22T03:13:40Z","snapshot_observed_at":"2026-08-11T21:52:54.745729Z","submitted_at":"2025-05-22T03:13:40Z","title":"Selective Invocation for Multilingual ASR: A Cost-effective Approach Adapting to Speech Recognition Difficulty","version":1},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-08-07T15:10:50.982722Z"},"links":{"cited_paper":"/paper/2311.07919","citing_paper":"/paper/2505.16168"},"observation_digest":"sha256:be64babc834c16a69aa1ca2d5abcafb4138c54e5b4c682985a6727e47ee87ac2","observation_id":"e1784789-fecc-41eb-9734-fd1f998b56d5","resolution":{"observed_at":"2026-08-07T15:10:50.982722Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:10:52.306152Z","title":"Wavllm: Towards robust and adaptive speech large language model,","venue":null,"work_id":"5144d7f8-a52d-4f32-9321-a626ef0ff06d","year":2024},"citing_paper":{"arxiv_id":"2505.16168","last_updated":"2025-05-22T03:13:40Z","snapshot_observed_at":"2026-08-11T21:52:54.745729Z","submitted_at":"2025-05-22T03:13:40Z","title":"Selective Invocation for Multilingual ASR: A Cost-effective Approach Adapting to Speech Recognition Difficulty","version":1},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-08-07T15:10:51.071343Z"},"links":{"citing_paper":"/paper/2505.16168"},"observation_digest":"sha256:86236b3afea90356e880544e0b142e7585497c33d9eb403e14a457adeac70493","observation_id":"2daee75c-cfe4-43f0-84ab-7385f75fec15","resolution":{"observed_at":"2026-08-07T15:10:52.358457Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2407.10759","last_updated":"2024-07-15T14:38:09Z","snapshot_observed_at":"2026-08-14T01:27:16.843576Z","submitted_at":"2024-07-15T14:38:09Z","title":"Qwen2-Audio Technical Report","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2407.10759","snapshot_observed_at":"2026-08-07T15:10:51.150455Z","title":"Qwen2-audio technical re- port,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.16168","last_updated":"2025-05-22T03:13:40Z","snapshot_observed_at":"2026-08-11T21:52:54.745729Z","submitted_at":"2025-05-22T03:13:40Z","title":"Selective Invocation for Multilingual ASR: A Cost-effective Approach Adapting to Speech Recognition Difficulty","version":1},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-08-07T15:10:51.150455Z"},"links":{"cited_paper":"/paper/2407.10759","citing_paper":"/paper/2505.16168"},"observation_digest":"sha256:5726b302fdf51504cde4182f003de1fd25e472971ae88f8491b10f12bae28657","observation_id":"a4a2d3d5-0c02-4aee-acd0-7b13ae146a45","resolution":{"observed_at":"2026-08-07T15:10:51.150455Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:10:52.173168Z","title":"E- chat: Emotion-sensitive spoken dialogue system with large lan- guage models,","venue":null,"work_id":"e90519fe-b942-4bdb-a566-20b0a7c06c92","year":2024},"citing_paper":{"arxiv_id":"2505.16168","last_updated":"2025-05-22T03:13:40Z","snapshot_observed_at":"2026-08-11T21:52:54.745729Z","submitted_at":"2025-05-22T03:13:40Z","title":"Selective Invocation for Multilingual ASR: A Cost-effective Approach Adapting to Speech Recognition Difficulty","version":1},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-08-07T15:10:51.218661Z"},"links":{"citing_paper":"/paper/2505.16168"},"observation_digest":"sha256:00482c28bcee79e1afbc3221fb2fddf88f8597d5216a669bb7f9ab0facf8c694","observation_id":"b9ac4d38-2cca-42b9-8cb3-6e02cc0dd118","resolution":{"observed_at":"2026-08-07T15:10:52.242816Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:10:52.060788Z","title":"MLS: A large-scale multilingual dataset for speech research,","venue":null,"work_id":"6662b6bc-5c51-43b2-a4d6-20fdf509dbf6","year":2020},"citing_paper":{"arxiv_id":"2505.16168","last_updated":"2025-05-22T03:13:40Z","snapshot_observed_at":"2026-08-11T21:52:54.745729Z","submitted_at":"2025-05-22T03:13:40Z","title":"Selective Invocation for Multilingual ASR: A Cost-effective Approach Adapting to Speech Recognition Difficulty","version":1},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-08-07T15:10:51.297410Z"},"links":{"citing_paper":"/paper/2505.16168"},"observation_digest":"sha256:306e257fcd783c068e3c823e25e4e1a12ab6f3735daab9fd4e26525cd9b22f39","observation_id":"3d7c462f-b596-4586-bc49-378cd92b3f4c","resolution":{"observed_at":"2026-08-07T15:10:52.114781Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:10:51.947840Z","title":"V oxpopuli: A large-scale multilingual speech corpus for representation learning, semi-supervised learning and interpretation,","venue":null,"work_id":"53dbbf2d-d639-4971-8d92-253b241eac07","year":2021},"citing_paper":{"arxiv_id":"2505.16168","last_updated":"2025-05-22T03:13:40Z","snapshot_observed_at":"2026-08-11T21:52:54.745729Z","submitted_at":"2025-05-22T03:13:40Z","title":"Selective Invocation for Multilingual ASR: A Cost-effective Approach Adapting to Speech Recognition Difficulty","version":1},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-08-07T15:10:51.368206Z"},"links":{"citing_paper":"/paper/2505.16168"},"observation_digest":"sha256:3f727cfdc5b75c1d75f815e69f978067a9656d2d52372374efeed815e82fee0d","observation_id":"0d2688b4-89cc-47f0-afe4-ceb27d073ec8","resolution":{"observed_at":"2026-08-07T15:10:51.999003Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:10:51.806838Z","title":"FLEURS: few-shot learning evaluation of universal representations of speech,","venue":null,"work_id":"ea16c525-9832-4dfd-af1b-96286cd93b16","year":2022},"citing_paper":{"arxiv_id":"2505.16168","last_updated":"2025-05-22T03:13:40Z","snapshot_observed_at":"2026-08-11T21:52:54.745729Z","submitted_at":"2025-05-22T03:13:40Z","title":"Selective Invocation for Multilingual ASR: A Cost-effective Approach Adapting to Speech Recognition Difficulty","version":1},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-08-07T15:10:51.425729Z"},"links":{"citing_paper":"/paper/2505.16168"},"observation_digest":"sha256:a4240dff1c26710142910ea3e0974540622ebb6976e25200279f51687d96c513","observation_id":"034e313c-cd43-4117-964d-6e6125ccd671","resolution":{"observed_at":"2026-08-07T15:10:51.869947Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2409.11214","last_updated":"2024-09-17T14:10:57Z","snapshot_observed_at":"2026-08-16T13:17:49.268769Z","submitted_at":"2024-09-17T14:10:57Z","title":"Ideal-LLM: Integrating Dual Encoders and Language-Adapted LLM for Multilingual Speech-to-Text","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2409.11214","snapshot_observed_at":"2026-08-07T15:10:51.482203Z","title":"Ideal-LLM: Integrating dual encoders and language-adapted llm for multilingual speech-to-text,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.16168","last_updated":"2025-05-22T03:13:40Z","snapshot_observed_at":"2026-08-11T21:52:54.745729Z","submitted_at":"2025-05-22T03:13:40Z","title":"Selective Invocation for Multilingual ASR: A Cost-effective Approach Adapting to Speech Recognition Difficulty","version":1},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-08-07T15:10:51.482203Z"},"links":{"cited_paper":"/paper/2409.11214","citing_paper":"/paper/2505.16168"},"observation_digest":"sha256:7c87928d646acb1e512af0c8e6fd4012074225e051e319fe9c82f5f92a3383d2","observation_id":"d27f961e-8767-4e96-9564-58be1f83ed6a","resolution":{"observed_at":"2026-08-07T15:10:51.482203Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2404.14219","last_updated":"2024-08-30T21:17:17Z","snapshot_observed_at":"2026-08-17T03:25:04.404839Z","submitted_at":"2024-04-22T14:32:33Z","title":"Phi-3 Technical Report: A Highly Capable Language Model Locally on Your Phone","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2404.14219","snapshot_observed_at":"2026-08-07T15:10:51.525953Z","title":"Phi-3 technical report: A highly capable language model locally on your phone,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.16168","last_updated":"2025-05-22T03:13:40Z","snapshot_observed_at":"2026-08-11T21:52:54.745729Z","submitted_at":"2025-05-22T03:13:40Z","title":"Selective Invocation for Multilingual ASR: A Cost-effective Approach Adapting to Speech Recognition Difficulty","version":1},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-08-07T15:10:51.525953Z"},"links":{"cited_paper":"/paper/2404.14219","citing_paper":"/paper/2505.16168"},"observation_digest":"sha256:c0c49193dc845fd406a0269261ee6be80d05f0c990e268440b3aa9a96ef1a995","observation_id":"459e50da-1967-46fa-9ada-747cd5cfef81","resolution":{"observed_at":"2026-08-07T15:10:51.525953Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"paper":{"arxiv_id":"2505.16168","last_updated":"2025-05-22T03:13:40Z","latest_version":1,"primary_category":"cs.SD","snapshot_observed_at":"2026-08-11T21:52:54.745729Z","submitted_at":"2025-05-22T03:13:40Z","title":"Selective Invocation for Multilingual ASR: A Cost-effective Approach Adapting to Speech Recognition Difficulty"},"reference_resolution":{"displayed":34,"state_counts":{"malformed_identifier":1,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":12,"verified_exact":1,"verified_fuzzy":20},"total_outbound_references":34},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"thesis":"As of 20 August 2026, this Paper Citation Record lists 34 of 34 outbound references and 1 inbound Pith citation observation for arXiv:2505.16168."}