{"as_of":"2026-08-11T11:10:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:1eaa60e9b022c490099fe50b2c51de533f14a6d0b57c1159711f148a3e31bae2","coverage":[{"denominator":0,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":24,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":24,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-11T06:34:44.6726+00:00","state":"measured"},{"denominator":24,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":24,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-10T21:15:41.008870Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":1,"source":"arxiv_reference","source_observed_at":"2026-08-05T02:28:24.338817Z","state":"measured"}],"external_citation_measurements":[{"count":116,"observed_at":"2026-08-05T02:28:24.338817Z","source":"arxiv_reference"}],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2305.13516","last_updated":"2023-05-22T22:09:41Z","snapshot_observed_at":"2026-08-02T15:37:26.541116Z","submitted_at":"2023-05-22T22:09:41Z","title":"Scaling Speech Technology to 1,000+ Languages","version":1},"cited_work":{"arxiv_id":"2305.13516","doi":"10.48550/arxiv.2305.13516","metadata_source":"arxiv_reference","pith_arxiv_id":"2305.13516","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Scaling speech technology to 1,000+ languages","venue":"arXiv (Cornell University)","work_id":"d85c5ee3-0310-48b2-b8c8-a24601ce26c1","year":2023},"citing_paper":{"arxiv_id":"2401.09512","last_updated":"2026-05-18T13:28:38Z","snapshot_observed_at":"2026-07-06T17:17:03.447619Z","submitted_at":"2024-01-17T15:09:02Z","title":"MLAAD: The Multi-Language Audio Anti-Spoofing Dataset","version":10},"reference_index":62,"source":"pdf_text","source_observed_at":"2026-05-24T04:34:59.205522Z"},"links":{"cited_paper":"/paper/2305.13516","citing_paper":"/paper/2401.09512"},"observation_digest":"sha256:99e76d6a389e8e82aa681c25436a76414214c0152839dd240907ef6c456fb3af","observation_id":"e3d61ba3-faed-4c9c-a3ef-41e280caaed2","resolution":{"observed_at":"2026-05-24T04:36:00.889425Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2305.13516","last_updated":"2023-05-22T22:09:41Z","snapshot_observed_at":"2026-08-02T15:37:26.541116Z","submitted_at":"2023-05-22T22:09:41Z","title":"Scaling Speech Technology to 1,000+ Languages","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2305.13516","snapshot_observed_at":"2026-08-10T21:15:41.008870Z","title":"Scaling speech technology to 1,000+ languages,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2501.05586","last_updated":"2025-01-09T21:39:09Z","snapshot_observed_at":"2026-08-10T21:10:34.833875Z","submitted_at":"2025-01-09T21:39:09Z","title":"FreeSVC: Towards Zero-shot Multilingual Singing Voice Conversion","version":1},"reference_index":38,"source":"pdf_text","source_observed_at":"2026-08-10T21:15:41.008870Z"},"links":{"cited_paper":"/paper/2305.13516","citing_paper":"/paper/2501.05586"},"observation_digest":"sha256:6bb7c49fd9734f6a61a361b192de6935530823300c1420dc3e505b59de6d1d99","observation_id":"553924f0-a986-4f16-b206-ba942c3f43d9","resolution":{"observed_at":"2026-08-10T21:15:41.008870Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2305.13516","last_updated":"2023-05-22T22:09:41Z","snapshot_observed_at":"2026-08-02T15:37:26.541116Z","submitted_at":"2023-05-22T22:09:41Z","title":"Scaling Speech Technology to 1,000+ Languages","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2305.13516","snapshot_observed_at":"2026-08-10T20:34:20.399211Z","title":"Scaling speech technology to 1,000+ languages,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2501.07875","last_updated":"2025-01-14T06:33:40Z","snapshot_observed_at":"2026-08-11T01:41:54.248756Z","submitted_at":"2025-01-14T06:33:40Z","title":"Continual Learning with Embedding Layer Surgery and Task-wise Beam Search using Whisper","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-10T20:34:20.399211Z"},"links":{"cited_paper":"/paper/2305.13516","citing_paper":"/paper/2501.07875"},"observation_digest":"sha256:d40495bead70a5643ddd7a6e5c3c82e235db91da9a743e06eac3116f95558db3","observation_id":"f23c4ab2-fcc3-43ed-a3d3-77c25acdf27c","resolution":{"observed_at":"2026-08-10T20:34:20.399211Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2305.13516","last_updated":"2023-05-22T22:09:41Z","snapshot_observed_at":"2026-08-02T15:37:26.541116Z","submitted_at":"2023-05-22T22:09:41Z","title":"Scaling Speech Technology to 1,000+ Languages","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2305.13516","snapshot_observed_at":"2026-08-07T18:32:14.831683Z","title":"Scaling speech technology to 1,000+ languages","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2502.10373","last_updated":"2025-02-14T18:51:40Z","snapshot_observed_at":"2026-08-11T08:35:03.220189Z","submitted_at":"2025-02-14T18:51:40Z","title":"OWLS: Scaling Laws for Multilingual Speech Recognition and Translation Models","version":1},"reference_index":50,"source":"arxiv_source","source_observed_at":"2026-08-07T18:32:14.831683Z"},"links":{"cited_paper":"/paper/2305.13516","citing_paper":"/paper/2502.10373"},"observation_digest":"sha256:b5479f3a95127c49c348d1e99b81b0590abe7a566a053decc937ced4e532c924","observation_id":"e553957c-9110-494f-a3e7-4b89ac1001d4","resolution":{"observed_at":"2026-08-07T18:32:14.831683Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2305.13516","last_updated":"2023-05-22T22:09:41Z","snapshot_observed_at":"2026-08-02T15:37:26.541116Z","submitted_at":"2023-05-22T22:09:41Z","title":"Scaling Speech Technology to 1,000+ Languages","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2305.13516","snapshot_observed_at":"2026-08-07T14:55:56.498003Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.16972","last_updated":"2025-05-22T17:51:05Z","snapshot_observed_at":"2026-08-09T09:32:42.256193Z","submitted_at":"2025-05-22T17:51:05Z","title":"From Tens of Hours to Tens of Thousands: Scaling Back-Translation for Speech Recognition","version":1},"reference_index":34,"source":"arxiv_source","source_observed_at":"2026-08-07T14:55:56.498003Z"},"links":{"cited_paper":"/paper/2305.13516","citing_paper":"/paper/2505.16972"},"observation_digest":"sha256:dcb0cecf00e816cfea1bad66aa63584ae55bc160745a276be3a62dd6e6bbd2b9","observation_id":"48978583-1258-41b0-8653-d9ddca2174a2","resolution":{"observed_at":"2026-08-07T14:55:56.498003Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2305.13516","last_updated":"2023-05-22T22:09:41Z","snapshot_observed_at":"2026-08-02T15:37:26.541116Z","submitted_at":"2023-05-22T22:09:41Z","title":"Scaling Speech Technology to 1,000+ Languages","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2305.13516","snapshot_observed_at":"2026-08-07T14:29:09.278802Z","title":"Scal- ing speech technology to 1,000+ languages,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.18860","last_updated":"2025-05-24T20:40:51Z","snapshot_observed_at":"2026-08-07T14:22:10.226379Z","submitted_at":"2025-05-24T20:40:51Z","title":"Context-Driven Dynamic Pruning for Large Speech Foundation Models","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-07T14:29:09.278802Z"},"links":{"cited_paper":"/paper/2305.13516","citing_paper":"/paper/2505.18860"},"observation_digest":"sha256:f709e13cf96534d0f9b1cc8e667d03d056c3bedbf92f1e301a559cb3b4232cd1","observation_id":"8cfc4100-3c36-4267-9218-487531fe4f54","resolution":{"observed_at":"2026-08-07T14:29:09.278802Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2305.13516","last_updated":"2023-05-22T22:09:41Z","snapshot_observed_at":"2026-08-02T15:37:26.541116Z","submitted_at":"2023-05-22T22:09:41Z","title":"Scaling Speech Technology to 1,000+ Languages","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2305.13516","snapshot_observed_at":"2026-08-07T12:35:28.487913Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.24561","last_updated":"2025-05-30T13:16:08Z","snapshot_observed_at":"2026-08-09T10:13:07.858419Z","submitted_at":"2025-05-30T13:16:08Z","title":"Improving Language and Modality Transfer in Translation by Character-level Modeling","version":1},"reference_index":35,"source":"arxiv_source","source_observed_at":"2026-08-07T12:35:28.487913Z"},"links":{"cited_paper":"/paper/2305.13516","citing_paper":"/paper/2505.24561"},"observation_digest":"sha256:ddf40412f928f72b64f469831c23b31bd912f0c377bb7db2ac80b20b9ca93296","observation_id":"551256bb-0573-477d-a3c7-b06cb9d58e4c","resolution":{"observed_at":"2026-08-07T12:35:28.487913Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2305.13516","last_updated":"2023-05-22T22:09:41Z","snapshot_observed_at":"2026-08-02T15:37:26.541116Z","submitted_at":"2023-05-22T22:09:41Z","title":"Scaling Speech Technology to 1,000+ Languages","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2305.13516","snapshot_observed_at":"2026-08-07T11:50:21.990733Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.01406","last_updated":"2025-06-02T08:02:44Z","snapshot_observed_at":"2026-08-07T11:41:14.981381Z","submitted_at":"2025-06-02T08:02:44Z","title":"Speech-to-Speech Translation Pipelines for Conversations in Low-Resource Languages","version":1},"reference_index":16,"source":"arxiv_source","source_observed_at":"2026-08-07T11:50:21.990733Z"},"links":{"cited_paper":"/paper/2305.13516","citing_paper":"/paper/2506.01406"},"observation_digest":"sha256:7dda255fbc7cbd801d661f37ba90c71f5a348b4ef491d82338b7029b427c115f","observation_id":"7f4d9657-85cc-41d7-9429-a4ab92bdb808","resolution":{"observed_at":"2026-08-07T11:50:21.990733Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2305.13516","last_updated":"2023-05-22T22:09:41Z","snapshot_observed_at":"2026-08-02T15:37:26.541116Z","submitted_at":"2023-05-22T22:09:41Z","title":"Scaling Speech Technology to 1,000+ Languages","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2305.13516","snapshot_observed_at":"2026-08-06T23:48:39.174752Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.15981","last_updated":"2025-06-28T05:47:16Z","snapshot_observed_at":"2026-08-10T08:31:47.566066Z","submitted_at":"2025-06-19T02:56:49Z","title":"Double Entendre: Robust Audio-Based AI-Generated Lyrics Detection via Multi-View Fusion","version":2},"reference_index":28,"source":"arxiv_source","source_observed_at":"2026-08-06T23:48:39.174752Z"},"links":{"cited_paper":"/paper/2305.13516","citing_paper":"/paper/2506.15981"},"observation_digest":"sha256:1c536364ed03945674259137d6ba57f86d1822fda8976b7d833f1133ccb53f58","observation_id":"307f9388-67b8-41fa-9068-7d207fb2a396","resolution":{"observed_at":"2026-08-06T23:48:39.174752Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2305.13516","last_updated":"2023-05-22T22:09:41Z","snapshot_observed_at":"2026-08-02T15:37:26.541116Z","submitted_at":"2023-05-22T22:09:41Z","title":"Scaling Speech Technology to 1,000+ Languages","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2305.13516","snapshot_observed_at":"2026-08-06T18:14:08.841029Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2507.08768","last_updated":"2025-07-11T17:27:11Z","snapshot_observed_at":"2026-08-09T19:10:35.728190Z","submitted_at":"2025-07-11T17:27:11Z","title":"On Barriers to Archival Audio Processing","version":1},"reference_index":11,"source":"arxiv_source","source_observed_at":"2026-08-06T18:14:08.841029Z"},"links":{"cited_paper":"/paper/2305.13516","citing_paper":"/paper/2507.08768"},"observation_digest":"sha256:aacde09201ce0fb14c07a7c3eba663b6e11e972a54836d236011f7d08d3f7b6a","observation_id":"5fab6ba7-56d8-410e-b917-55ded70f0929","resolution":{"observed_at":"2026-08-06T18:14:08.841029Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2305.13516","last_updated":"2023-05-22T22:09:41Z","snapshot_observed_at":"2026-08-02T15:37:26.541116Z","submitted_at":"2023-05-22T22:09:41Z","title":"Scaling Speech Technology to 1,000+ Languages","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2305.13516","snapshot_observed_at":"2026-08-06T19:56:20.540912Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2507.08832","last_updated":"2025-07-06T06:18:41Z","snapshot_observed_at":"2026-08-06T19:49:54.521474Z","submitted_at":"2025-07-06T06:18:41Z","title":"A Hybrid Machine Learning Framework for Optimizing Crop Selection via Agronomic and Economic Forecasting","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-06T19:56:20.540912Z"},"links":{"cited_paper":"/paper/2305.13516","citing_paper":"/paper/2507.08832"},"observation_digest":"sha256:0e6d2ca2a8bcacd6ef3d2078c46809b85d27ee0d08272a639a1d81faf9af29b1","observation_id":"ab8d4adc-37bd-45eb-920c-f7370d130374","resolution":{"observed_at":"2026-08-06T19:56:20.540912Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2305.13516","last_updated":"2023-05-22T22:09:41Z","snapshot_observed_at":"2026-08-02T15:37:26.541116Z","submitted_at":"2023-05-22T22:09:41Z","title":"Scaling Speech Technology to 1,000+ Languages","version":1},"cited_work":{"arxiv_id":"2305.13516","doi":"10.48550/arxiv.2305.13516","metadata_source":"arxiv_reference","pith_arxiv_id":"2305.13516","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Scaling speech technology to 1,000+ languages","venue":"arXiv (Cornell University)","work_id":"d85c5ee3-0310-48b2-b8c8-a24601ce26c1","year":2023},"citing_paper":{"arxiv_id":"2512.20481","last_updated":"2026-04-15T12:23:46Z","snapshot_observed_at":"2026-08-03T04:20:46.583285Z","submitted_at":"2025-12-23T16:16:42Z","title":"Coherence in the brain unfolds across separable temporal regimes","version":4},"reference_index":43,"source":"pdf_text","source_observed_at":"2026-05-16T20:11:29.476625Z"},"links":{"cited_paper":"/paper/2305.13516","citing_paper":"/paper/2512.20481"},"observation_digest":"sha256:5d9e24ade6b0897170e05389933cae0aeca2b30cc70efcfd5ca22b884bbe00d2","observation_id":"c7afc37d-fa66-4172-ae08-6e15342c902e","resolution":{"observed_at":"2026-05-16T20:13:22.862525Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2305.13516","last_updated":"2023-05-22T22:09:41Z","snapshot_observed_at":"2026-08-02T15:37:26.541116Z","submitted_at":"2023-05-22T22:09:41Z","title":"Scaling Speech Technology to 1,000+ Languages","version":1},"cited_work":{"arxiv_id":"2305.13516","doi":"10.48550/arxiv.2305.13516","metadata_source":"arxiv_reference","pith_arxiv_id":"2305.13516","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Scaling speech technology to 1,000+ languages","venue":"arXiv (Cornell University)","work_id":"d85c5ee3-0310-48b2-b8c8-a24601ce26c1","year":2023},"citing_paper":{"arxiv_id":"2604.02374","last_updated":"2026-04-27T15:09:03Z","snapshot_observed_at":"2026-08-08T01:21:02.694310Z","submitted_at":"2026-03-31T20:35:26Z","title":"Evaluating Generalization and Robustness in Russian Anti-Spoofing: The RuASD Initiative","version":2},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-05-08T02:27:05.776290Z"},"links":{"cited_paper":"/paper/2305.13516","citing_paper":"/paper/2604.02374"},"observation_digest":"sha256:5ee26edc8759894be3a42f8ab7b6c129948741c0362eef29963ea134db6bc445","observation_id":"ddd22543-ba0a-49e6-a203-fe708de2b2d7","resolution":{"observed_at":"2026-05-11T22:46:12.487399Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2305.13516","last_updated":"2023-05-22T22:09:41Z","snapshot_observed_at":"2026-08-02T15:37:26.541116Z","submitted_at":"2023-05-22T22:09:41Z","title":"Scaling Speech Technology to 1,000+ Languages","version":1},"cited_work":{"arxiv_id":"2305.13516","doi":"10.48550/arxiv.2305.13516","metadata_source":"arxiv_reference","pith_arxiv_id":"2305.13516","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Scaling speech technology to 1,000+ languages","venue":"arXiv (Cornell University)","work_id":"d85c5ee3-0310-48b2-b8c8-a24601ce26c1","year":2023},"citing_paper":{"arxiv_id":"2604.04598","last_updated":"2026-04-06T11:23:42Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2026-04-06T11:23:42Z","title":"Benchmarking Multilingual Speech Models on Pashto: Zero-Shot ASR, Script Failure, and Cross-Domain Evaluation","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-05-10T19:44:30.762851Z"},"links":{"cited_paper":"/paper/2305.13516","citing_paper":"/paper/2604.04598"},"observation_digest":"sha256:4568a66b4bd5aa63d3eac73c24bc8ae138adf1750a97d6cda922a45a6a05225c","observation_id":"60d89d46-3473-489f-b9c7-f81ed640d2c2","resolution":{"observed_at":"2026-05-10T22:35:48.754248Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2305.13516","last_updated":"2023-05-22T22:09:41Z","snapshot_observed_at":"2026-08-02T15:37:26.541116Z","submitted_at":"2023-05-22T22:09:41Z","title":"Scaling Speech Technology to 1,000+ Languages","version":1},"cited_work":{"arxiv_id":"2305.13516","doi":"10.48550/arxiv.2305.13516","metadata_source":"arxiv_reference","pith_arxiv_id":"2305.13516","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Scaling speech technology to 1,000+ languages","venue":"arXiv (Cornell University)","work_id":"d85c5ee3-0310-48b2-b8c8-a24601ce26c1","year":2023},"citing_paper":{"arxiv_id":"2604.10123","last_updated":"2026-04-11T09:38:35Z","snapshot_observed_at":"2026-07-06T22:58:47.599383Z","submitted_at":"2026-04-11T09:38:35Z","title":"Training-Free Cross-Lingual Dysarthria Severity Assessment via Phonological Subspace Analysis in Self-Supervised Speech Representations","version":1},"reference_index":50,"source":"pdf_text","source_observed_at":"2026-05-10T16:16:39.890339Z"},"links":{"cited_paper":"/paper/2305.13516","citing_paper":"/paper/2604.10123"},"observation_digest":"sha256:1d647bc7e23662c89b6205ffedbdad3f6370c0f042669ea57442a40bace027e4","observation_id":"5a19eb96-1e3a-4e65-864c-e643fa3a51a4","resolution":{"observed_at":"2026-05-11T09:05:58.892265Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2305.13516","last_updated":"2023-05-22T22:09:41Z","snapshot_observed_at":"2026-08-02T15:37:26.541116Z","submitted_at":"2023-05-22T22:09:41Z","title":"Scaling Speech Technology to 1,000+ Languages","version":1},"cited_work":{"arxiv_id":"2305.13516","doi":"10.48550/arxiv.2305.13516","metadata_source":"arxiv_reference","pith_arxiv_id":"2305.13516","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Scaling speech technology to 1,000+ languages","venue":"arXiv (Cornell University)","work_id":"d85c5ee3-0310-48b2-b8c8-a24601ce26c1","year":2023},"citing_paper":{"arxiv_id":"2604.10736","last_updated":"2026-04-16T21:22:01Z","snapshot_observed_at":"2026-07-06T22:59:18.756089Z","submitted_at":"2026-04-12T17:17:54Z","title":"BlasBench: An Open Benchmark for Irish Speech Recognition","version":2},"reference_index":26,"source":"arxiv_source","source_observed_at":"2026-05-10T15:53:54.092426Z"},"links":{"cited_paper":"/paper/2305.13516","citing_paper":"/paper/2604.10736"},"observation_digest":"sha256:c76ecc703a9cbe8618438da0aa58a543f4b1a0695e7fff691ab7cc601462ec68","observation_id":"5e08dc38-63c2-469d-8de7-cc5d58a180b1","resolution":{"observed_at":"2026-05-11T09:41:01.558355Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2305.13516","last_updated":"2023-05-22T22:09:41Z","snapshot_observed_at":"2026-08-02T15:37:26.541116Z","submitted_at":"2023-05-22T22:09:41Z","title":"Scaling Speech Technology to 1,000+ Languages","version":1},"cited_work":{"arxiv_id":"2305.13516","doi":"10.48550/arxiv.2305.13516","metadata_source":"arxiv_reference","pith_arxiv_id":"2305.13516","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Scaling speech technology to 1,000+ languages","venue":"arXiv (Cornell University)","work_id":"d85c5ee3-0310-48b2-b8c8-a24601ce26c1","year":2023},"citing_paper":{"arxiv_id":"2604.18932","last_updated":"2026-04-21T00:13:30Z","snapshot_observed_at":"2026-07-06T23:05:39.724237Z","submitted_at":"2026-04-21T00:13:30Z","title":"Tadabur: A Large-Scale Quran Audio Dataset","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-05-10T02:16:09.216191Z"},"links":{"cited_paper":"/paper/2305.13516","citing_paper":"/paper/2604.18932"},"observation_digest":"sha256:fcaa9fbee680d6b09e69d860166c51e039ff902965ff8bce57fab75105552649","observation_id":"d41f838d-44b4-43e7-a11a-56f15e06e0f4","resolution":{"observed_at":"2026-05-11T13:11:03.683889Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2305.13516","last_updated":"2023-05-22T22:09:41Z","snapshot_observed_at":"2026-08-02T15:37:26.541116Z","submitted_at":"2023-05-22T22:09:41Z","title":"Scaling Speech Technology to 1,000+ Languages","version":1},"cited_work":{"arxiv_id":"2305.13516","doi":"10.48550/arxiv.2305.13516","metadata_source":"arxiv_reference","pith_arxiv_id":"2305.13516","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Scaling speech technology to 1,000+ languages","venue":"arXiv (Cornell University)","work_id":"d85c5ee3-0310-48b2-b8c8-a24601ce26c1","year":2023},"citing_paper":{"arxiv_id":"2605.01381","last_updated":"2026-05-02T11:08:10Z","snapshot_observed_at":"2026-08-09T00:23:18.733056Z","submitted_at":"2026-05-02T11:08:10Z","title":"A framework for analyzing concept representations in neural models","version":1},"reference_index":189,"source":"arxiv_source","source_observed_at":"2026-05-09T14:49:22.776209Z"},"links":{"cited_paper":"/paper/2305.13516","citing_paper":"/paper/2605.01381"},"observation_digest":"sha256:87f8f03519f17828d37dace567499f1d09e9d463d2e0a1cb2b38e8b889af4660","observation_id":"1d0a1619-11f1-432b-8a93-44166d0ee087","resolution":{"observed_at":"2026-05-09T22:18:59.078659Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2305.13516","last_updated":"2023-05-22T22:09:41Z","snapshot_observed_at":"2026-08-02T15:37:26.541116Z","submitted_at":"2023-05-22T22:09:41Z","title":"Scaling Speech Technology to 1,000+ Languages","version":1},"cited_work":{"arxiv_id":"2305.13516","doi":"10.48550/arxiv.2305.13516","metadata_source":"arxiv_reference","pith_arxiv_id":"2305.13516","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Scaling speech technology to 1,000+ languages","venue":"arXiv (Cornell University)","work_id":"d85c5ee3-0310-48b2-b8c8-a24601ce26c1","year":2023},"citing_paper":{"arxiv_id":"2606.09317","last_updated":"2026-06-08T10:27:33Z","snapshot_observed_at":"2026-08-08T02:28:42.099385Z","submitted_at":"2026-06-08T10:27:33Z","title":"A Comparative Study of Pre-trained Speech Encoders and Training Objectives for Large-Scale Indic Spoken Language Identification","version":1},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-06-27T15:12:45.261874Z"},"links":{"cited_paper":"/paper/2305.13516","citing_paper":"/paper/2606.09317"},"observation_digest":"sha256:1a5c6e1919641a0257209be61c2a6f281557a270d93fede677da523add736f45","observation_id":"f7355c90-ca9c-4bb5-971f-fb6fc32b7c38","resolution":{"observed_at":"2026-07-03T03:37:35.361386Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2305.13516","last_updated":"2023-05-22T22:09:41Z","snapshot_observed_at":"2026-08-02T15:37:26.541116Z","submitted_at":"2023-05-22T22:09:41Z","title":"Scaling Speech Technology to 1,000+ Languages","version":1},"cited_work":{"arxiv_id":"2305.13516","doi":"10.48550/arxiv.2305.13516","metadata_source":"arxiv_reference","pith_arxiv_id":"2305.13516","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Scaling speech technology to 1,000+ languages","venue":"arXiv (Cornell University)","work_id":"d85c5ee3-0310-48b2-b8c8-a24601ce26c1","year":2023},"citing_paper":{"arxiv_id":"2606.11542","last_updated":"2026-06-10T01:07:32Z","snapshot_observed_at":"2026-08-04T09:55:13.088817Z","submitted_at":"2026-06-10T01:07:32Z","title":"Pretrained self-supervised speech models can recognize unseen consonants","version":1},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-06-27T10:14:47.932613Z"},"links":{"cited_paper":"/paper/2305.13516","citing_paper":"/paper/2606.11542"},"observation_digest":"sha256:6ee18a32489692ece2dd18cd06c305f12677dd7a1fcd1441e84c37918b830fb1","observation_id":"41a4aab9-8e7e-4b78-90f1-602b7d0e7f87","resolution":{"observed_at":"2026-07-03T10:07:56.073107Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2305.13516","last_updated":"2023-05-22T22:09:41Z","snapshot_observed_at":"2026-08-02T15:37:26.541116Z","submitted_at":"2023-05-22T22:09:41Z","title":"Scaling Speech Technology to 1,000+ Languages","version":1},"cited_work":{"arxiv_id":"2305.13516","doi":"10.48550/arxiv.2305.13516","metadata_source":"arxiv_reference","pith_arxiv_id":"2305.13516","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Scaling speech technology to 1,000+ languages","venue":"arXiv (Cornell University)","work_id":"d85c5ee3-0310-48b2-b8c8-a24601ce26c1","year":2023},"citing_paper":{"arxiv_id":"2606.26618","last_updated":"2026-06-25T05:27:18Z","snapshot_observed_at":"2026-08-11T04:06:44.456931Z","submitted_at":"2026-06-25T05:27:18Z","title":"Closing the Quality Gap in Low-Resource Text-to-Speech: LoRA Fine-Tuning of VoxCPM2 for Khmer and Korean","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-06-26T05:24:03.268025Z"},"links":{"cited_paper":"/paper/2305.13516","citing_paper":"/paper/2606.26618"},"observation_digest":"sha256:8ed2d9ab4037f079448f831e0c8e27226418e3fdd6d68cb9d8cdd34393b4a893","observation_id":"c7c44471-50e5-4550-bed9-a73c4eed6376","resolution":{"observed_at":"2026-07-04T13:19:50.277522Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2305.13516","last_updated":"2023-05-22T22:09:41Z","snapshot_observed_at":"2026-08-02T15:37:26.541116Z","submitted_at":"2023-05-22T22:09:41Z","title":"Scaling Speech Technology to 1,000+ Languages","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2305.13516","snapshot_observed_at":"2026-07-12T00:48:21.716770Z","title":"Scaling speech tech- nology to 1,000+ languages,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.03670","last_updated":"2026-07-04T02:50:05Z","snapshot_observed_at":"2026-08-07T11:27:04.089670Z","submitted_at":"2026-07-04T02:50:05Z","title":"CHILDES-Aligned: A Curated Children's Speech Dataset via Multi-Model Timestamp Ensembling","version":1},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-07-12T00:48:21.716770Z"},"links":{"cited_paper":"/paper/2305.13516","citing_paper":"/paper/2607.03670"},"observation_digest":"sha256:5c073b99bb5f350cbd496d921154552b80bc68deb68b99560c2e00403b3d036d","observation_id":"10db3fde-f1e0-4ce7-a1ea-aa0756afa508","resolution":{"observed_at":"2026-07-12T00:48:21.716770Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2305.13516","last_updated":"2023-05-22T22:09:41Z","snapshot_observed_at":"2026-08-02T15:37:26.541116Z","submitted_at":"2023-05-22T22:09:41Z","title":"Scaling Speech Technology to 1,000+ Languages","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2305.13516","snapshot_observed_at":"2026-07-11T18:11:36.626189Z","title":"Scaling speech technology to 1,000+ languages,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2607.04515","last_updated":"2026-07-05T21:37:15Z","snapshot_observed_at":"2026-08-09T11:08:37.752353Z","submitted_at":"2026-07-05T21:37:15Z","title":"Towards Digital Preservation of Efik: TTS for a Low-Resource African Language","version":1},"reference_index":38,"source":"pdf_text","source_observed_at":"2026-07-11T18:11:36.626189Z"},"links":{"cited_paper":"/paper/2305.13516","citing_paper":"/paper/2607.04515"},"observation_digest":"sha256:8ec889f6805d40eff01a9815ed8e81f1e1d8c8deb59dfdeaa4f42e04c82ce7e9","observation_id":"ba5de31c-da83-4527-8f35-47a42e0f611b","resolution":{"observed_at":"2026-07-11T18:11:36.626189Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2305.13516","last_updated":"2023-05-22T22:09:41Z","snapshot_observed_at":"2026-08-02T15:37:26.541116Z","submitted_at":"2023-05-22T22:09:41Z","title":"Scaling Speech Technology to 1,000+ Languages","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2305.13516","snapshot_observed_at":"2026-08-01T07:10:39.841258Z","title":"Pratap, A","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2607.21540","last_updated":"2026-07-24T18:05:20Z","snapshot_observed_at":"2026-08-07T09:16:01.540251Z","submitted_at":"2026-07-23T17:25:08Z","title":"DONDO: Open w2v-BERT Speech-Recognition Base Models for African Languages","version":2},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-01T07:10:39.841258Z"},"links":{"cited_paper":"/paper/2305.13516","citing_paper":"/paper/2607.21540"},"observation_digest":"sha256:da7f90ed01aa3be4c6b4e9c5de59b0f35a26bfd337662c90762a404c3d252cf2","observation_id":"69f96c9a-58e0-4b13-9b50-9cae96658e6c","resolution":{"observed_at":"2026-08-01T07:10:39.841258Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"links":{"evidence":"/evidence","html":"/paper/2305.13516/citation-record","integrity":"/paper/2305.13516/integrity","json":"/paper/2305.13516/citation-record.json","paper":"/paper/2305.13516"},"outbound":[],"paper":{"arxiv_id":"2305.13516","last_updated":"2023-05-22T22:09:41Z","latest_version":1,"primary_category":"cs.CL","snapshot_observed_at":"2026-08-02T15:37:26.541116Z","submitted_at":"2023-05-22T22:09:41Z","title":"Scaling Speech Technology to 1,000+ Languages"},"reference_resolution":{"displayed":0,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":0,"verified_exact":0,"verified_fuzzy":0},"total_outbound_references":0},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"thesis":"As of 11 August 2026, this Paper Citation Record lists 0 of 0 outbound references and 24 inbound Pith citation observations for arXiv:2305.13516."}