{"as_of":"2026-08-10T02:17:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:3a798d90c4a409ac3cf2fbd189ecbc39b1c2ae6525d27c09b6cf8f3512d172f5","coverage":[{"denominator":42,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":42,"source":"paper_references, paper_reference_links","source_observed_at":"2026-07-14T12:15:06.470439Z","state":"measured"},{"denominator":43,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":43,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-09T06:31:02.800959+00:00","state":"measured"},{"denominator":1,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":1,"source":"paper_references, paper_reference_links","source_observed_at":"2026-07-14T12:15:06.470439Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2607.10371","last_updated":"2026-07-11T15:48:03Z","snapshot_observed_at":"2026-08-07T10:45:20.188896Z","submitted_at":"2026-07-11T15:48:03Z","title":"GigaAM Multilingual: Foundation Model for Underrepresented Languages","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2607.10371","snapshot_observed_at":"2026-07-14T12:15:06.470439Z","title":null,"venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2607.10371","last_updated":"2026-07-11T15:48:03Z","snapshot_observed_at":"2026-08-07T10:45:20.188896Z","submitted_at":"2026-07-11T15:48:03Z","title":"GigaAM Multilingual: Foundation Model for Underrepresented Languages","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-07-14T12:15:06.470439Z"},"links":{"cited_paper":"/paper/2607.10371","citing_paper":"/paper/2607.10371"},"observation_digest":"sha256:e9988ed1b2d002f59a1eac2099ac3a3501a59df4fd86399bec93eb1303f1a875","observation_id":"d61fe4a4-4b4e-4b8e-9573-294d1c6508aa","resolution":{"observed_at":"2026-07-14T12:15:06.470439Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"links":{"evidence":"/evidence","html":"/paper/2607.10371/citation-record","integrity":"/paper/2607.10371/integrity","json":"/paper/2607.10371/citation-record.json","paper":"/paper/2607.10371"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-14T12:15:06.470439Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.10371","last_updated":"2026-07-11T15:48:03Z","snapshot_observed_at":"2026-08-07T10:45:20.188896Z","submitted_at":"2026-07-11T15:48:03Z","title":"GigaAM Multilingual: Foundation Model for Underrepresented Languages","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-07-14T12:15:06.470439Z"},"links":{"citing_paper":"/paper/2607.10371"},"observation_digest":"sha256:04d3433bc5614fd0e0698f2b67e27943a0370c29512c85c4109ed836bd537053","observation_id":"9be9d37e-c2b2-496b-81c1-f7e3cc7bf605","resolution":{"observed_at":"2026-07-14T12:15:06.470439Z","resolver_source":null,"status":"malformed_identifier"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2607.10371","last_updated":"2026-07-11T15:48:03Z","snapshot_observed_at":"2026-08-07T10:45:20.188896Z","submitted_at":"2026-07-11T15:48:03Z","title":"GigaAM Multilingual: Foundation Model for Underrepresented Languages","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2607.10371","snapshot_observed_at":"2026-07-14T12:15:06.470439Z","title":null,"venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2607.10371","last_updated":"2026-07-11T15:48:03Z","snapshot_observed_at":"2026-08-07T10:45:20.188896Z","submitted_at":"2026-07-11T15:48:03Z","title":"GigaAM Multilingual: Foundation Model for Underrepresented Languages","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-07-14T12:15:06.470439Z"},"links":{"cited_paper":"/paper/2607.10371","citing_paper":"/paper/2607.10371"},"observation_digest":"sha256:e9988ed1b2d002f59a1eac2099ac3a3501a59df4fd86399bec93eb1303f1a875","observation_id":"d61fe4a4-4b4e-4b8e-9573-294d1c6508aa","resolution":{"observed_at":"2026-07-14T12:15:06.470439Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-14T12:15:06.470439Z","title":"uncertain","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.10371","last_updated":"2026-07-11T15:48:03Z","snapshot_observed_at":"2026-08-07T10:45:20.188896Z","submitted_at":"2026-07-11T15:48:03Z","title":"GigaAM Multilingual: Foundation Model for Underrepresented Languages","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-07-14T12:15:06.470439Z"},"links":{"citing_paper":"/paper/2607.10371"},"observation_digest":"sha256:3a5fa9472d8755e8eda6e392af3dbddea8efa574faebf51298c966e6acabd0c7","observation_id":"5cd6ce53-190e-4ccc-a6cd-bed3e1b3137c","resolution":{"observed_at":"2026-07-14T12:15:06.470439Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-14T12:15:06.470439Z","title":"centre”→“center","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.10371","last_updated":"2026-07-11T15:48:03Z","snapshot_observed_at":"2026-08-07T10:45:20.188896Z","submitted_at":"2026-07-11T15:48:03Z","title":"GigaAM Multilingual: Foundation Model for Underrepresented Languages","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-07-14T12:15:06.470439Z"},"links":{"citing_paper":"/paper/2607.10371"},"observation_digest":"sha256:1bb97f4e27b644f072855ff898fba6e1f95349c673fdf8b7ee5260af9f768260","observation_id":"f8182e16-7996-4c9c-9663-55647349575c","resolution":{"observed_at":"2026-07-14T12:15:06.470439Z","resolver_source":null,"status":"malformed_identifier"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-14T12:15:06.470439Z","title":"We introduce GigaAM Multilingual, a Conformer en- coder pre-trained on 2M hours of audio using a cluster-aware sampling strategy","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.10371","last_updated":"2026-07-11T15:48:03Z","snapshot_observed_at":"2026-08-07T10:45:20.188896Z","submitted_at":"2026-07-11T15:48:03Z","title":"GigaAM Multilingual: Foundation Model for Underrepresented Languages","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-07-14T12:15:06.470439Z"},"links":{"citing_paper":"/paper/2607.10371"},"observation_digest":"sha256:ee9d4aa9df2da414e50346eca610c2c79df10e982d794fb929bbb227a4f525d1","observation_id":"68989239-52ea-42ba-b079-b0a565ca4acb","resolution":{"observed_at":"2026-07-14T12:15:06.470439Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-14T12:15:06.470439Z","title":"The authors reviewed and revised all AI-assisted edits and take full responsibility for the content, claims, experimental results, and conclusions of this paper","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.10371","last_updated":"2026-07-11T15:48:03Z","snapshot_observed_at":"2026-08-07T10:45:20.188896Z","submitted_at":"2026-07-11T15:48:03Z","title":"GigaAM Multilingual: Foundation Model for Underrepresented Languages","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-07-14T12:15:06.470439Z"},"links":{"citing_paper":"/paper/2607.10371"},"observation_digest":"sha256:6923155e62252b7dc1c8128dd8c78b0f50d8d0c279da02a4612a31278cc2e0b9","observation_id":"1afdf5cb-9991-412a-83e9-99fe27c50f8b","resolution":{"observed_at":"2026-07-14T12:15:06.470439Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-14T12:15:06.470439Z","title":"Robust speech recognition via large-scale weak supervision,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2607.10371","last_updated":"2026-07-11T15:48:03Z","snapshot_observed_at":"2026-08-07T10:45:20.188896Z","submitted_at":"2026-07-11T15:48:03Z","title":"GigaAM Multilingual: Foundation Model for Underrepresented Languages","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-07-14T12:15:06.470439Z"},"links":{"citing_paper":"/paper/2607.10371"},"observation_digest":"sha256:b2f95c6b6bc74d8339f68aa8c1ee94ad6fd19434e57e0fbb4de541dbd3a2f000","observation_id":"5d1b874d-bd42-4891-81c7-aa4c9a011260","resolution":{"observed_at":"2026-07-14T12:15:06.470439Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2303.01037","last_updated":"2023-09-25T01:20:23Z","snapshot_observed_at":"2026-08-04T01:36:29.191456Z","submitted_at":"2023-03-02T07:47:18Z","title":"Google USM: Scaling Automatic Speech Recognition Beyond 100 Languages","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2303.01037","snapshot_observed_at":"2026-07-14T12:15:06.470439Z","title":"Google USM: Scaling automatic speech recognition beyond 100 languages,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2607.10371","last_updated":"2026-07-11T15:48:03Z","snapshot_observed_at":"2026-08-07T10:45:20.188896Z","submitted_at":"2026-07-11T15:48:03Z","title":"GigaAM Multilingual: Foundation Model for Underrepresented Languages","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-07-14T12:15:06.470439Z"},"links":{"cited_paper":"/paper/2303.01037","citing_paper":"/paper/2607.10371"},"observation_digest":"sha256:0473f8ea019f05b2e52d31cd139de8541422a16733686677bb105177f6eaf675","observation_id":"e9f7d5bc-f704-408a-9c4b-c39d313442b4","resolution":{"observed_at":"2026-07-14T12:15:06.470439Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-14T12:15:06.470439Z","title":"Scaling speech technology to 1,000+ languages,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.10371","last_updated":"2026-07-11T15:48:03Z","snapshot_observed_at":"2026-08-07T10:45:20.188896Z","submitted_at":"2026-07-11T15:48:03Z","title":"GigaAM Multilingual: Foundation Model for Underrepresented Languages","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-07-14T12:15:06.470439Z"},"links":{"citing_paper":"/paper/2607.10371"},"observation_digest":"sha256:cb845fb3433a4c6420559016f07eb8503588c21716905739d10f76b973391f81","observation_id":"889a9b6f-3264-4c13-ac05-2f75b5b1d8ab","resolution":{"observed_at":"2026-07-14T12:15:06.470439Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-14T12:15:06.470439Z","title":"Available: http://jmlr.org/papers/v25/23-1318","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.10371","last_updated":"2026-07-11T15:48:03Z","snapshot_observed_at":"2026-08-07T10:45:20.188896Z","submitted_at":"2026-07-11T15:48:03Z","title":"GigaAM Multilingual: Foundation Model for Underrepresented Languages","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-07-14T12:15:06.470439Z"},"links":{"citing_paper":"/paper/2607.10371"},"observation_digest":"sha256:d606c1bfdc0d56b48e999a3a383093a568dd2a992e15a76d20d1358677881e07","observation_id":"b88651f0-baf6-4736-b08d-fe2dc494bc10","resolution":{"observed_at":"2026-07-14T12:15:06.470439Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-14T12:15:06.470439Z","title":"Omnilingual asr: Open-source multilingual speech recognition for 1600+ languages,","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.10371","last_updated":"2026-07-11T15:48:03Z","snapshot_observed_at":"2026-08-07T10:45:20.188896Z","submitted_at":"2026-07-11T15:48:03Z","title":"GigaAM Multilingual: Foundation Model for Underrepresented Languages","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-07-14T12:15:06.470439Z"},"links":{"citing_paper":"/paper/2607.10371"},"observation_digest":"sha256:10a6e095ab87174a3885e15e8e8564e432991a8a1e0493ad8649b2ad727a7216","observation_id":"888eefd7-41d3-4092-a820-6d68ff553484","resolution":{"observed_at":"2026-07-14T12:15:06.470439Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-14T12:15:06.470439Z","title":"The ML-SUPERB 2.0 Challenge: Towards In- clusive ASR Benchmarking for All Language Varieties,","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.10371","last_updated":"2026-07-11T15:48:03Z","snapshot_observed_at":"2026-08-07T10:45:20.188896Z","submitted_at":"2026-07-11T15:48:03Z","title":"GigaAM Multilingual: Foundation Model for Underrepresented Languages","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-07-14T12:15:06.470439Z"},"links":{"citing_paper":"/paper/2607.10371"},"observation_digest":"sha256:c3d600b09b29e32ed4d65835b63026a0e435c8919176086ce5256f5611754b01","observation_id":"1063d487-f647-42fd-9899-0b710060bb36","resolution":{"observed_at":"2026-07-14T12:15:06.470439Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-14T12:15:06.470439Z","title":"mHuBERT-147: A Compact Multilingual HuBERT Model,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.10371","last_updated":"2026-07-11T15:48:03Z","snapshot_observed_at":"2026-08-07T10:45:20.188896Z","submitted_at":"2026-07-11T15:48:03Z","title":"GigaAM Multilingual: Foundation Model for Underrepresented Languages","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-07-14T12:15:06.470439Z"},"links":{"citing_paper":"/paper/2607.10371"},"observation_digest":"sha256:e3fa0c36f09fdf3ac8dfba46bff7b34d96ff01cade7f02b002b66a6e3f43a922","observation_id":"346eb9d2-f306-4604-9366-a4fd5ced41d0","resolution":{"observed_at":"2026-07-14T12:15:06.470439Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-14T12:15:06.470439Z","title":"GigaAM: Efficient Self-Supervised Learner for Speech Recognition,","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.10371","last_updated":"2026-07-11T15:48:03Z","snapshot_observed_at":"2026-08-07T10:45:20.188896Z","submitted_at":"2026-07-11T15:48:03Z","title":"GigaAM Multilingual: Foundation Model for Underrepresented Languages","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-07-14T12:15:06.470439Z"},"links":{"citing_paper":"/paper/2607.10371"},"observation_digest":"sha256:ef699e9ec09a1eaaaa568c9d1e0e1958c2055deb0ef11b6c4c5c0d2a25e5a827","observation_id":"0c9bc925-6089-4613-90d9-2ced99f0764e","resolution":{"observed_at":"2026-07-14T12:15:06.470439Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-14T12:15:06.470439Z","title":"wav2vec 2.0: A framework for self-supervised learning of speech representa- tions,","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2607.10371","last_updated":"2026-07-11T15:48:03Z","snapshot_observed_at":"2026-08-07T10:45:20.188896Z","submitted_at":"2026-07-11T15:48:03Z","title":"GigaAM Multilingual: Foundation Model for Underrepresented Languages","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-07-14T12:15:06.470439Z"},"links":{"citing_paper":"/paper/2607.10371"},"observation_digest":"sha256:d87493812cfbbfd8c78ce1c6b985225b73e44f803eaefbcdd23a496620890c14","observation_id":"34496957-8b35-4807-9578-d6f79ca9287a","resolution":{"observed_at":"2026-07-14T12:15:06.470439Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-14T12:15:06.470439Z","title":"Hubert: Self-supervised speech rep- resentation learning by masked prediction of hidden units,","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2607.10371","last_updated":"2026-07-11T15:48:03Z","snapshot_observed_at":"2026-08-07T10:45:20.188896Z","submitted_at":"2026-07-11T15:48:03Z","title":"GigaAM Multilingual: Foundation Model for Underrepresented Languages","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-07-14T12:15:06.470439Z"},"links":{"citing_paper":"/paper/2607.10371"},"observation_digest":"sha256:208152b191dd998fcf25f1d98bb5a8a1e78cb0e40ebdcc22f5cd9da3f1a39501","observation_id":"4c637a33-271f-48e6-bfa7-e31bb043c42b","resolution":{"observed_at":"2026-07-14T12:15:06.470439Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2111.09296","last_updated":"2021-12-16T18:29:22Z","snapshot_observed_at":"2026-07-06T12:09:37.468149Z","submitted_at":"2021-11-17T18:49:42Z","title":"XLS-R: Self-supervised Cross-lingual Speech Representation Learning at Scale","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2111.09296","snapshot_observed_at":"2026-07-14T12:15:06.470439Z","title":"XLS-R: Self-supervised cross- lingual speech representation learning at scale,","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2607.10371","last_updated":"2026-07-11T15:48:03Z","snapshot_observed_at":"2026-08-07T10:45:20.188896Z","submitted_at":"2026-07-11T15:48:03Z","title":"GigaAM Multilingual: Foundation Model for Underrepresented Languages","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-07-14T12:15:06.470439Z"},"links":{"cited_paper":"/paper/2111.09296","citing_paper":"/paper/2607.10371"},"observation_digest":"sha256:0a3848ceb97dc5c1dce8188a765a945ce09179a23df1f8fa065586673d57326a","observation_id":"2d8c6bc4-790e-437b-acb7-3688e45872b3","resolution":{"observed_at":"2026-07-14T12:15:06.470439Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-14T12:15:06.470439Z","title":"GigaSpeech 2: An evolving, large-scale and multi-domain ASR corpus for low-resource languages with automated crawling, transcription and refinement,","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.10371","last_updated":"2026-07-11T15:48:03Z","snapshot_observed_at":"2026-08-07T10:45:20.188896Z","submitted_at":"2026-07-11T15:48:03Z","title":"GigaAM Multilingual: Foundation Model for Underrepresented Languages","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-07-14T12:15:06.470439Z"},"links":{"citing_paper":"/paper/2607.10371"},"observation_digest":"sha256:fa60d89be1717448d27b00740aeb838bb0740e775f196429cccf7a5bded1cc12","observation_id":"67efeacc-0be1-4266-8a16-15e6c5f47caa","resolution":{"observed_at":"2026-07-14T12:15:06.470439Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-14T12:15:06.470439Z","title":"On the Effects of Heterogeneous Data Sources on Speech-to- Text Foundation Models,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.10371","last_updated":"2026-07-11T15:48:03Z","snapshot_observed_at":"2026-08-07T10:45:20.188896Z","submitted_at":"2026-07-11T15:48:03Z","title":"GigaAM Multilingual: Foundation Model for Underrepresented Languages","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-07-14T12:15:06.470439Z"},"links":{"citing_paper":"/paper/2607.10371"},"observation_digest":"sha256:677fab242aa6ac8776a040ab1a37c74a0347a820ea3635e288a4775db45c6605","observation_id":"c6575b29-54ca-4468-96a9-a882eb09dde0","resolution":{"observed_at":"2026-07-14T12:15:06.470439Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-14T12:15:06.470439Z","title":"OWSM v4: Improving Open Whisper-Style Speech Models via Data Scaling and Cleaning,","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.10371","last_updated":"2026-07-11T15:48:03Z","snapshot_observed_at":"2026-08-07T10:45:20.188896Z","submitted_at":"2026-07-11T15:48:03Z","title":"GigaAM Multilingual: Foundation Model for Underrepresented Languages","version":1},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-07-14T12:15:06.470439Z"},"links":{"citing_paper":"/paper/2607.10371"},"observation_digest":"sha256:0ad59b5227a1bd93a324ddc5e4fcf022bf23bde57c932c7fd166bf66e90d2ff7","observation_id":"b09525f2-549f-496e-8752-6c9580852165","resolution":{"observed_at":"2026-07-14T12:15:06.470439Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2104.09864","last_updated":"2023-11-08T13:36:32Z","snapshot_observed_at":"2026-07-06T11:01:58.137141Z","submitted_at":"2021-04-20T09:54:06Z","title":"RoFormer: Enhanced Transformer with Rotary Position Embedding","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2104.09864","snapshot_observed_at":"2026-07-14T12:15:06.470439Z","title":"Ro- former: Enhanced transformer with rotary position embedding,","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2607.10371","last_updated":"2026-07-11T15:48:03Z","snapshot_observed_at":"2026-08-07T10:45:20.188896Z","submitted_at":"2026-07-11T15:48:03Z","title":"GigaAM Multilingual: Foundation Model for Underrepresented Languages","version":1},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-07-14T12:15:06.470439Z"},"links":{"cited_paper":"/paper/2104.09864","citing_paper":"/paper/2607.10371"},"observation_digest":"sha256:2ead7632eceb3be278ceb1e7cb90ea71ad67ed4566b34db8139db1ee097415d1","observation_id":"bc2daae0-f67f-4eb5-9aed-a9985ca80e7e","resolution":{"observed_at":"2026-07-14T12:15:06.470439Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-14T12:15:06.470439Z","title":"Finding community structure in very large networks,","venue":null,"work_id":null,"year":2004},"citing_paper":{"arxiv_id":"2607.10371","last_updated":"2026-07-11T15:48:03Z","snapshot_observed_at":"2026-08-07T10:45:20.188896Z","submitted_at":"2026-07-11T15:48:03Z","title":"GigaAM Multilingual: Foundation Model for Underrepresented Languages","version":1},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-07-14T12:15:06.470439Z"},"links":{"citing_paper":"/paper/2607.10371"},"observation_digest":"sha256:b3b2ca0b1fb6e4fd3fcd18971d03d3c608fa3d9355181e5a3d282ddd88810a6f","observation_id":"8fa418c3-29f3-4a73-a864-eeccd7af4679","resolution":{"observed_at":"2026-07-14T12:15:06.470439Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-14T12:15:06.470439Z","title":"Connectionist temporal classification: labelling unsegmented sequence data with recurrent neural networks,","venue":null,"work_id":null,"year":2006},"citing_paper":{"arxiv_id":"2607.10371","last_updated":"2026-07-11T15:48:03Z","snapshot_observed_at":"2026-08-07T10:45:20.188896Z","submitted_at":"2026-07-11T15:48:03Z","title":"GigaAM Multilingual: Foundation Model for Underrepresented Languages","version":1},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-07-14T12:15:06.470439Z"},"links":{"citing_paper":"/paper/2607.10371"},"observation_digest":"sha256:26af75922083146aecaa53be8f190c659732d2d3870143eea38ae1dd3a5b6885","observation_id":"0e9c1fba-5541-4e89-a9c0-543aff5147e9","resolution":{"observed_at":"2026-07-14T12:15:06.470439Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-14T12:15:06.470439Z","title":"Common voice: A massively-multilingual speech corpus,","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2607.10371","last_updated":"2026-07-11T15:48:03Z","snapshot_observed_at":"2026-08-07T10:45:20.188896Z","submitted_at":"2026-07-11T15:48:03Z","title":"GigaAM Multilingual: Foundation Model for Underrepresented Languages","version":1},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-07-14T12:15:06.470439Z"},"links":{"citing_paper":"/paper/2607.10371"},"observation_digest":"sha256:41ae30a0f76de917c3145c3d5e6be99603a8547677bd17686b54ad7c7757f205","observation_id":"5641afb8-f818-4fc8-ac56-ea726b3a388f","resolution":{"observed_at":"2026-07-14T12:15:06.470439Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-14T12:15:06.470439Z","title":"Fleurs: Few-shot learning evaluation of universal representations of speech,","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2607.10371","last_updated":"2026-07-11T15:48:03Z","snapshot_observed_at":"2026-08-07T10:45:20.188896Z","submitted_at":"2026-07-11T15:48:03Z","title":"GigaAM Multilingual: Foundation Model for Underrepresented Languages","version":1},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-07-14T12:15:06.470439Z"},"links":{"citing_paper":"/paper/2607.10371"},"observation_digest":"sha256:e85f8272ae8689dd43449939ea1f1442cb8f60fd297b0d4f2b38fefb88e5263f","observation_id":"d9292ca4-343d-46a7-9d4c-7149002eb500","resolution":{"observed_at":"2026-07-14T12:15:06.470439Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-14T12:15:06.470439Z","title":"Golos: Russian Dataset for Speech Research,","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2607.10371","last_updated":"2026-07-11T15:48:03Z","snapshot_observed_at":"2026-08-07T10:45:20.188896Z","submitted_at":"2026-07-11T15:48:03Z","title":"GigaAM Multilingual: Foundation Model for Underrepresented Languages","version":1},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-07-14T12:15:06.470439Z"},"links":{"citing_paper":"/paper/2607.10371"},"observation_digest":"sha256:5aeefb05ce0fc722c6de1ce48a55a73655143a59b95354e76b0e8be351c4854a","observation_id":"e97a3d55-b635-4827-a5ed-7973f10d4e18","resolution":{"observed_at":"2026-07-14T12:15:06.470439Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-14T12:15:06.470439Z","title":"A toolbox for construction and analysis of speech datasets,","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2607.10371","last_updated":"2026-07-11T15:48:03Z","snapshot_observed_at":"2026-08-07T10:45:20.188896Z","submitted_at":"2026-07-11T15:48:03Z","title":"GigaAM Multilingual: Foundation Model for Underrepresented Languages","version":1},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-07-14T12:15:06.470439Z"},"links":{"citing_paper":"/paper/2607.10371"},"observation_digest":"sha256:00640018b23bddb107d3e88e37a3802523881e771aa9a8a953fa2985b6ae35b8","observation_id":"0dca92fc-fd7f-452a-a148-d9a23c5c3d20","resolution":{"observed_at":"2026-07-14T12:15:06.470439Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-14T12:15:06.470439Z","title":"Europarl-ASR: A large corpus of parliamentary debates for streaming ASR benchmarking and speech data filtering/verbatimization,","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2607.10371","last_updated":"2026-07-11T15:48:03Z","snapshot_observed_at":"2026-08-07T10:45:20.188896Z","submitted_at":"2026-07-11T15:48:03Z","title":"GigaAM Multilingual: Foundation Model for Underrepresented Languages","version":1},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-07-14T12:15:06.470439Z"},"links":{"citing_paper":"/paper/2607.10371"},"observation_digest":"sha256:3cc532594a574ee18c7cba6cd6881dd5b3fee0c9a3fb3874372fd371a4b54062","observation_id":"7043f081-2cf7-4da0-af61-9cddcb73ed96","resolution":{"observed_at":"2026-07-14T12:15:06.470439Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-14T12:15:06.470439Z","title":"Lib- riSpeech: An ASR corpus based on public domain audio books,","venue":null,"work_id":null,"year":2015},"citing_paper":{"arxiv_id":"2607.10371","last_updated":"2026-07-11T15:48:03Z","snapshot_observed_at":"2026-08-07T10:45:20.188896Z","submitted_at":"2026-07-11T15:48:03Z","title":"GigaAM Multilingual: Foundation Model for Underrepresented Languages","version":1},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-07-14T12:15:06.470439Z"},"links":{"citing_paper":"/paper/2607.10371"},"observation_digest":"sha256:2883c008fc069bac63899da4c35ff434964ec79cad2d399b5bf52c94346de97f","observation_id":"9d7eb27f-23ce-4919-bc23-14c4fda3651b","resolution":{"observed_at":"2026-07-14T12:15:06.470439Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-14T12:15:06.470439Z","title":"The people’s speech: A large-scale diverse english speech recognition dataset for commercial usage,","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2607.10371","last_updated":"2026-07-11T15:48:03Z","snapshot_observed_at":"2026-08-07T10:45:20.188896Z","submitted_at":"2026-07-11T15:48:03Z","title":"GigaAM Multilingual: Foundation Model for Underrepresented Languages","version":1},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-07-14T12:15:06.470439Z"},"links":{"citing_paper":"/paper/2607.10371"},"observation_digest":"sha256:7534cfdcc7db29bd30ae2440c786797120f0fd438c333852fe223555233aa67f","observation_id":"f1cd8cd8-6c3f-4a88-85c0-b4ff4b72b921","resolution":{"observed_at":"2026-07-14T12:15:06.470439Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-14T12:15:06.470439Z","title":"SLURP: A spoken language understanding resource package,","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2607.10371","last_updated":"2026-07-11T15:48:03Z","snapshot_observed_at":"2026-08-07T10:45:20.188896Z","submitted_at":"2026-07-11T15:48:03Z","title":"GigaAM Multilingual: Foundation Model for Underrepresented Languages","version":1},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-07-14T12:15:06.470439Z"},"links":{"citing_paper":"/paper/2607.10371"},"observation_digest":"sha256:5ad127fa0ce2d029a359b2db9b17e0ef20c9c34601dce74a305e4de344dd2951","observation_id":"1248d36d-41ff-47a5-baaa-205d264bc859","resolution":{"observed_at":"2026-07-14T12:15:06.470439Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-14T12:15:06.470439Z","title":"SPGISpeech: 5,000 hours of transcribed fi- nancial audio for fully formatted end-to-end speech recognition,","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2607.10371","last_updated":"2026-07-11T15:48:03Z","snapshot_observed_at":"2026-08-07T10:45:20.188896Z","submitted_at":"2026-07-11T15:48:03Z","title":"GigaAM Multilingual: Foundation Model for Underrepresented Languages","version":1},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-07-14T12:15:06.470439Z"},"links":{"citing_paper":"/paper/2607.10371"},"observation_digest":"sha256:893ee6f0ddc39cacbaf67f577c1b04c0048a81df10f34871ba368c1311da0c7a","observation_id":"285afe87-ccd4-4be5-ba80-e478440347a5","resolution":{"observed_at":"2026-07-14T12:15:06.470439Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-14T12:15:06.470439Z","title":"TED-LIUM 3: Twice as much data and corpus repar- tition for experiments on speaker adaptation,","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2607.10371","last_updated":"2026-07-11T15:48:03Z","snapshot_observed_at":"2026-08-07T10:45:20.188896Z","submitted_at":"2026-07-11T15:48:03Z","title":"GigaAM Multilingual: Foundation Model for Underrepresented Languages","version":1},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-07-14T12:15:06.470439Z"},"links":{"citing_paper":"/paper/2607.10371"},"observation_digest":"sha256:19ce4daf36cfecd85a46a294382387575decc54e94593797f2edd6724127483a","observation_id":"efae1ac8-bfef-487e-9fde-ddb3d536b042","resolution":{"observed_at":"2026-07-14T12:15:06.470439Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-14T12:15:06.470439Z","title":"CSTR VCTK cor- pus: English multi-speaker corpus for CSTR voice cloning toolkit (version 0.92),","venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2607.10371","last_updated":"2026-07-11T15:48:03Z","snapshot_observed_at":"2026-08-07T10:45:20.188896Z","submitted_at":"2026-07-11T15:48:03Z","title":"GigaAM Multilingual: Foundation Model for Underrepresented Languages","version":1},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-07-14T12:15:06.470439Z"},"links":{"citing_paper":"/paper/2607.10371"},"observation_digest":"sha256:829130916daae8e4a4c4ab20cb51bceba54ecaf7cacf96ee5a5bd526622abc64","observation_id":"51135a93-3e68-41a3-ac17-aaaf169f4cc1","resolution":{"observed_at":"2026-07-14T12:15:06.470439Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-14T12:15:06.470439Z","title":"V oxForge,","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2607.10371","last_updated":"2026-07-11T15:48:03Z","snapshot_observed_at":"2026-08-07T10:45:20.188896Z","submitted_at":"2026-07-11T15:48:03Z","title":"GigaAM Multilingual: Foundation Model for Underrepresented Languages","version":1},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-07-14T12:15:06.470439Z"},"links":{"citing_paper":"/paper/2607.10371"},"observation_digest":"sha256:fa612d069124e29a96a453d67994aaa4a346b88fed2b1e7c4d62e123db210e45","observation_id":"2cb01b85-f87d-4802-99a4-38e8eac8fc49","resolution":{"observed_at":"2026-07-14T12:15:06.470439Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-14T12:15:06.470439Z","title":"Usc: An open-source uzbek speech corpus and initial speech recognition experiments,","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2607.10371","last_updated":"2026-07-11T15:48:03Z","snapshot_observed_at":"2026-08-07T10:45:20.188896Z","submitted_at":"2026-07-11T15:48:03Z","title":"GigaAM Multilingual: Foundation Model for Underrepresented Languages","version":1},"reference_index":36,"source":"pdf_text","source_observed_at":"2026-07-14T12:15:06.470439Z"},"links":{"citing_paper":"/paper/2607.10371"},"observation_digest":"sha256:d4d7b22d83b7837616bd5bec3a63c659800cf073de8b30c346215e49d6bc9653","observation_id":"f156286b-746c-4e75-90fc-1772479d654e","resolution":{"observed_at":"2026-07-14T12:15:06.470439Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-14T12:15:06.470439Z","title":"KSC2: An Industrial-Scale Open-Source Kazakh Speech Corpus,","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2607.10371","last_updated":"2026-07-11T15:48:03Z","snapshot_observed_at":"2026-08-07T10:45:20.188896Z","submitted_at":"2026-07-11T15:48:03Z","title":"GigaAM Multilingual: Foundation Model for Underrepresented Languages","version":1},"reference_index":37,"source":"pdf_text","source_observed_at":"2026-07-14T12:15:06.470439Z"},"links":{"citing_paper":"/paper/2607.10371"},"observation_digest":"sha256:10fdc7df2427ec26154c90e82e08195fd091c0c5da5a22fe5fdc8bda62fde6ca","observation_id":"491029b0-7cac-4011-a1e9-cc64563818fe","resolution":{"observed_at":"2026-07-14T12:15:06.470439Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-14T12:15:06.470439Z","title":"KazakhTTS: An Open-Source Kazakh Text-to-Speech Synthesis Dataset,","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2607.10371","last_updated":"2026-07-11T15:48:03Z","snapshot_observed_at":"2026-08-07T10:45:20.188896Z","submitted_at":"2026-07-11T15:48:03Z","title":"GigaAM Multilingual: Foundation Model for Underrepresented Languages","version":1},"reference_index":38,"source":"pdf_text","source_observed_at":"2026-07-14T12:15:06.470439Z"},"links":{"citing_paper":"/paper/2607.10371"},"observation_digest":"sha256:c8a83c9bd3fc74ee36ab984b2a47042b9af056d566a7429f37e86ffdb72d7aaa","observation_id":"755b17cc-63ed-49dc-b0f4-5dc5bf79a60b","resolution":{"observed_at":"2026-07-14T12:15:06.470439Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-14T12:15:06.470439Z","title":"Yodas: Youtube-oriented dataset for audio and speech,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2607.10371","last_updated":"2026-07-11T15:48:03Z","snapshot_observed_at":"2026-08-07T10:45:20.188896Z","submitted_at":"2026-07-11T15:48:03Z","title":"GigaAM Multilingual: Foundation Model for Underrepresented Languages","version":1},"reference_index":39,"source":"pdf_text","source_observed_at":"2026-07-14T12:15:06.470439Z"},"links":{"citing_paper":"/paper/2607.10371"},"observation_digest":"sha256:e6e29dae91b2cee5efbefa38378d483228625faf75c59d464464e9702b766799","observation_id":"1a2010f5-4b60-4382-9b52-31d2a5200cd6","resolution":{"observed_at":"2026-07-14T12:15:06.470439Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-14T12:15:06.470439Z","title":"A post-processing system to yield reduced word er- ror rates: Recognizer output voting error reduction (rover),","venue":null,"work_id":null,"year":1997},"citing_paper":{"arxiv_id":"2607.10371","last_updated":"2026-07-11T15:48:03Z","snapshot_observed_at":"2026-08-07T10:45:20.188896Z","submitted_at":"2026-07-11T15:48:03Z","title":"GigaAM Multilingual: Foundation Model for Underrepresented Languages","version":1},"reference_index":40,"source":"pdf_text","source_observed_at":"2026-07-14T12:15:06.470439Z"},"links":{"citing_paper":"/paper/2607.10371"},"observation_digest":"sha256:580eb65031e7c33ce9bb7d044b1b85949deb3cd5fe74035b962490f63a53cda5","observation_id":"2dc52c86-6be4-44c5-8455-e73ae6d1b752","resolution":{"observed_at":"2026-07-14T12:15:06.470439Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-14T12:15:06.470439Z","title":"mT5: A massively multilingual pre-trained text-to-text transformer,","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2607.10371","last_updated":"2026-07-11T15:48:03Z","snapshot_observed_at":"2026-08-07T10:45:20.188896Z","submitted_at":"2026-07-11T15:48:03Z","title":"GigaAM Multilingual: Foundation Model for Underrepresented Languages","version":1},"reference_index":41,"source":"pdf_text","source_observed_at":"2026-07-14T12:15:06.470439Z"},"links":{"citing_paper":"/paper/2607.10371"},"observation_digest":"sha256:4e130503fe35b231face4655e1c635afa391659dbc9a6ce96ddd2bb60f990008","observation_id":"f574848a-27f2-4444-8825-a33e467a0a54","resolution":{"observed_at":"2026-07-14T12:15:06.470439Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2312.05187","last_updated":"2023-12-08T17:18:42Z","snapshot_observed_at":"2026-08-06T14:36:57.042438Z","submitted_at":"2023-12-08T17:18:42Z","title":"Seamless: Multilingual Expressive and Streaming Speech Translation","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2312.05187","snapshot_observed_at":"2026-07-14T12:15:06.470439Z","title":"Seamless: Multilingual expressive and streaming speech translation,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2607.10371","last_updated":"2026-07-11T15:48:03Z","snapshot_observed_at":"2026-08-07T10:45:20.188896Z","submitted_at":"2026-07-11T15:48:03Z","title":"GigaAM Multilingual: Foundation Model for Underrepresented Languages","version":1},"reference_index":42,"source":"pdf_text","source_observed_at":"2026-07-14T12:15:06.470439Z"},"links":{"cited_paper":"/paper/2312.05187","citing_paper":"/paper/2607.10371"},"observation_digest":"sha256:fe12e42f5f2ce061624836ba0750f497f1faa0b8ce76228b8ed07642dfcceae0","observation_id":"d9c7ef2d-ae9c-4011-a625-d203dc28a578","resolution":{"observed_at":"2026-07-14T12:15:06.470439Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"paper":{"arxiv_id":"2607.10371","last_updated":"2026-07-11T15:48:03Z","latest_version":1,"primary_category":"eess.AS","snapshot_observed_at":"2026-08-07T10:45:20.188896Z","submitted_at":"2026-07-11T15:48:03Z","title":"GigaAM Multilingual: Foundation Model for Underrepresented Languages"},"reference_resolution":{"displayed":42,"state_counts":{"malformed_identifier":2,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":40,"verified_exact":0,"verified_fuzzy":0},"total_outbound_references":42},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"thesis":"As of 10 August 2026, this Paper Citation Record lists 42 of 42 outbound references and 1 inbound Pith citation observation for arXiv:2607.10371."}