{"as_of":"2026-08-09T19:08:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:3dec715adfff3b7e93abbbd1e0e5fb50c85cee778864e217a729def05a20918a","coverage":[{"denominator":0,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":22,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":22,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-09T06:31:02.800959+00:00","state":"measured"},{"denominator":22,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":22,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-09T12:27:19.302520Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"arxiv_reference","source_observed_at":"2026-07-04T08:09:41.969238Z","state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2006.13979","last_updated":"2020-12-15T23:19:19Z","snapshot_observed_at":"2026-08-09T01:00:21.805016Z","submitted_at":"2020-06-24T18:25:05Z","title":"Unsupervised Cross-lingual Representation Learning for Speech Recognition","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2006.13979","snapshot_observed_at":"2026-08-09T12:27:19.302520Z","title":"Unsupervised Cross-lingual Representation Learning for Speech Recognition,","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2502.02366","last_updated":"2025-02-04T14:50:12Z","snapshot_observed_at":"2026-08-09T18:49:27.826019Z","submitted_at":"2025-02-04T14:50:12Z","title":"Self-Supervised Convolutional Audio Models are Flexible Acoustic Feature Learners: A Domain Specificity and Transfer-Learning Study","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-09T12:27:19.302520Z"},"links":{"cited_paper":"/paper/2006.13979","citing_paper":"/paper/2502.02366"},"observation_digest":"sha256:8958ebdf41c37585dde72b7f28c13217f607f8b3509fc1663a0fa28d7b422c7f","observation_id":"53867186-9827-4bb7-a66c-f5990b2fb264","resolution":{"observed_at":"2026-08-09T12:27:19.302520Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2006.13979","last_updated":"2020-12-15T23:19:19Z","snapshot_observed_at":"2026-08-09T01:00:21.805016Z","submitted_at":"2020-06-24T18:25:05Z","title":"Unsupervised Cross-lingual Representation Learning for Speech Recognition","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2006.13979","snapshot_observed_at":"2026-08-09T10:37:03.570902Z","title":"Unsupervised cross-lingual representation learning for speech recognition","venue":null,"work_id":null,"year":2006},"citing_paper":{"arxiv_id":"2502.02942","last_updated":"2025-02-05T07:14:39Z","snapshot_observed_at":"2026-08-09T10:28:59.080733Z","submitted_at":"2025-02-05T07:14:39Z","title":"GenSE: Generative Speech Enhancement via Language Models using Hierarchical Modeling","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-09T10:37:03.570902Z"},"links":{"cited_paper":"/paper/2006.13979","citing_paper":"/paper/2502.02942"},"observation_digest":"sha256:8df42b75f6b0da106ad1a71e0d5dea2e4e98c6b0902d761c9c371502e347eda5","observation_id":"31249799-37a2-4892-b4d0-c234593b4b53","resolution":{"observed_at":"2026-08-09T10:37:03.570902Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2006.13979","last_updated":"2020-12-15T23:19:19Z","snapshot_observed_at":"2026-08-09T01:00:21.805016Z","submitted_at":"2020-06-24T18:25:05Z","title":"Unsupervised Cross-lingual Representation Learning for Speech Recognition","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2006.13979","snapshot_observed_at":"2026-08-07T12:55:40.024238Z","title":"InProceedings of the 2024 Conference on Empirical Methods in Natural Language Processing, pages 10205–10224, Miami, Florida, USA","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.23170","last_updated":"2025-05-29T07:08:23Z","snapshot_observed_at":"2026-08-09T15:47:21.308983Z","submitted_at":"2025-05-29T07:08:23Z","title":"ZIPA: A family of efficient models for multilingual phone recognition","version":1},"reference_index":2024,"source":"pdf_text","source_observed_at":"2026-08-07T12:55:40.024238Z"},"links":{"cited_paper":"/paper/2006.13979","citing_paper":"/paper/2505.23170"},"observation_digest":"sha256:ec02541f2c368897c03868506e3e286d69d957b9e2ea5d615212300507c88b34","observation_id":"0e429902-49c8-44c6-97b5-1fe27a9c0ce7","resolution":{"observed_at":"2026-08-07T12:55:40.024238Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2006.13979","last_updated":"2020-12-15T23:19:19Z","snapshot_observed_at":"2026-08-09T01:00:21.805016Z","submitted_at":"2020-06-24T18:25:05Z","title":"Unsupervised Cross-lingual Representation Learning for Speech Recognition","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2006.13979","snapshot_observed_at":"2026-08-07T12:37:59.266363Z","title":"Unsupervised cross-lingual representation learning for speech recognition","venue":null,"work_id":null,"year":2006},"citing_paper":{"arxiv_id":"2506.00087","last_updated":"2025-05-30T05:54:46Z","snapshot_observed_at":"2026-08-07T12:25:49.461882Z","submitted_at":"2025-05-30T05:54:46Z","title":"SwitchLingua: The First Large-Scale Multilingual and Multi-Ethnic Code-Switching Dataset","version":1},"reference_index":12,"source":"arxiv_source","source_observed_at":"2026-08-07T12:37:59.266363Z"},"links":{"cited_paper":"/paper/2006.13979","citing_paper":"/paper/2506.00087"},"observation_digest":"sha256:8131f8f88d478f52a5591c479d512825155456f10d45d4b7f19e551b27727d50","observation_id":"a85d6171-4281-455f-9264-4deca39ca57f","resolution":{"observed_at":"2026-08-07T12:37:59.266363Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2006.13979","last_updated":"2020-12-15T23:19:19Z","snapshot_observed_at":"2026-08-09T01:00:21.805016Z","submitted_at":"2020-06-24T18:25:05Z","title":"Unsupervised Cross-lingual Representation Learning for Speech Recognition","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2006.13979","snapshot_observed_at":"2026-08-07T12:14:42.285623Z","title":"arXiv preprint arXiv:2006.13979","venue":null,"work_id":null,"year":2006},"citing_paper":{"arxiv_id":"2506.00145","last_updated":"2025-05-30T18:36:54Z","snapshot_observed_at":"2026-08-09T01:00:50.804857Z","submitted_at":"2025-05-30T18:36:54Z","title":"Vedavani: A Benchmark Corpus for ASR on Vedic Sanskrit Poetry","version":1},"reference_index":2020,"source":"pdf_text","source_observed_at":"2026-08-07T12:14:42.285623Z"},"links":{"cited_paper":"/paper/2006.13979","citing_paper":"/paper/2506.00145"},"observation_digest":"sha256:94dc75f74657097a97d73101125385106fdc5499433628bfd541ec14745e1f78","observation_id":"98ab8b0e-39c6-44e4-9cf5-c318e8c5a46f","resolution":{"observed_at":"2026-08-07T12:14:42.285623Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2006.13979","last_updated":"2020-12-15T23:19:19Z","snapshot_observed_at":"2026-08-09T01:00:21.805016Z","submitted_at":"2020-06-24T18:25:05Z","title":"Unsupervised Cross-lingual Representation Learning for Speech Recognition","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2006.13979","snapshot_observed_at":"2026-08-07T05:01:46.820340Z","title":null,"venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2506.09009","last_updated":"2025-06-11T05:35:33Z","snapshot_observed_at":"2026-08-09T01:01:03.525741Z","submitted_at":"2025-06-10T17:37:56Z","title":"UD-KSL Treebank v1.3: A semi-automated framework for aligning XPOS-extracted units with UPOS tags","version":2},"reference_index":3,"source":"arxiv_source","source_observed_at":"2026-08-07T05:01:46.820340Z"},"links":{"cited_paper":"/paper/2006.13979","citing_paper":"/paper/2506.09009"},"observation_digest":"sha256:3445199d81ed3465b4dfb1bf6b3eccff3ca2c3a828f7d9c27f85cf9e6c2911ea","observation_id":"e52cc9c2-3249-4c6f-96fe-1ffed8a1af08","resolution":{"observed_at":"2026-08-07T05:01:46.820340Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2006.13979","last_updated":"2020-12-15T23:19:19Z","snapshot_observed_at":"2026-08-09T01:00:21.805016Z","submitted_at":"2020-06-24T18:25:05Z","title":"Unsupervised Cross-lingual Representation Learning for Speech Recognition","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2006.13979","snapshot_observed_at":"2026-08-06T23:34:49.820015Z","title":null,"venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2506.17525","last_updated":"2025-06-27T18:38:01Z","snapshot_observed_at":"2026-08-08T04:12:41.309353Z","submitted_at":"2025-06-21T00:34:18Z","title":"Data Quality Issues in Multilingual Speech Datasets: The Need for Sociolinguistic Awareness and Proactive Language Planning","version":2},"reference_index":11,"source":"arxiv_source","source_observed_at":"2026-08-06T23:34:49.820015Z"},"links":{"cited_paper":"/paper/2006.13979","citing_paper":"/paper/2506.17525"},"observation_digest":"sha256:fe55c1e27a8ef77caa79058b69b63ff13dbf12af2511cd0d0bff62c957eeb12d","observation_id":"f1b31344-c420-416c-9a96-ebf90e51f097","resolution":{"observed_at":"2026-08-06T23:34:49.820015Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2006.13979","last_updated":"2020-12-15T23:19:19Z","snapshot_observed_at":"2026-08-09T01:00:21.805016Z","submitted_at":"2020-06-24T18:25:05Z","title":"Unsupervised Cross-lingual Representation Learning for Speech Recognition","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2006.13979","snapshot_observed_at":"2026-08-06T21:13:14.129554Z","title":"Unsupervised cross-lingual representation learning for speech recognition,","venue":null,"work_id":null,"year":2006},"citing_paper":{"arxiv_id":"2507.00693","last_updated":"2025-07-01T11:45:23Z","snapshot_observed_at":"2026-08-09T01:01:12.503917Z","submitted_at":"2025-07-01T11:45:23Z","title":"Leveraging Large Language Models for Spontaneous Speech-Based Suicide Risk Detection","version":1},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-08-06T21:13:14.129554Z"},"links":{"cited_paper":"/paper/2006.13979","citing_paper":"/paper/2507.00693"},"observation_digest":"sha256:e83294ce87095b554c63638f71859a0feafc231446962ff23ad912c9c83d1012","observation_id":"88cb9a4f-b88e-4145-8c66-caeb5886c12d","resolution":{"observed_at":"2026-08-06T21:13:14.129554Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2006.13979","last_updated":"2020-12-15T23:19:19Z","snapshot_observed_at":"2026-08-09T01:00:21.805016Z","submitted_at":"2020-06-24T18:25:05Z","title":"Unsupervised Cross-lingual Representation Learning for Speech Recognition","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2006.13979","snapshot_observed_at":"2026-08-05T15:39:22.322031Z","title":"Unsupervised cross-lingual representation learning for speech recognition","venue":null,"work_id":null,"year":2006},"citing_paper":{"arxiv_id":"2508.19671","last_updated":"2025-08-27T08:31:01Z","snapshot_observed_at":"2026-08-08T11:09:40.756020Z","submitted_at":"2025-08-27T08:31:01Z","title":"Hybrid Decoding: Rapid Pass and Selective Detailed Correction for Sequence Models","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-05T15:39:22.322031Z"},"links":{"cited_paper":"/paper/2006.13979","citing_paper":"/paper/2508.19671"},"observation_digest":"sha256:a550c5478d51ec85d0a189d63382466657519de3a67c3358e73123e19a435b83","observation_id":"c0d15c12-3187-4410-894e-48984a8915a1","resolution":{"observed_at":"2026-08-05T15:39:22.322031Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2006.13979","last_updated":"2020-12-15T23:19:19Z","snapshot_observed_at":"2026-08-09T01:00:21.805016Z","submitted_at":"2020-06-24T18:25:05Z","title":"Unsupervised Cross-lingual Representation Learning for Speech Recognition","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2006.13979","snapshot_observed_at":"2026-08-05T15:27:29.308951Z","title":"Un- supervised cross-lingual representation learning for speech recognition,","venue":null,"work_id":null,"year":2006},"citing_paper":{"arxiv_id":"2508.19856","last_updated":"2025-08-27T13:16:31Z","snapshot_observed_at":"2026-08-09T01:00:45.704886Z","submitted_at":"2025-08-27T13:16:31Z","title":"TokenVerse++: Towards Flexible Multitask Learning with Dynamic Task Activation","version":1},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-05T15:27:29.308951Z"},"links":{"cited_paper":"/paper/2006.13979","citing_paper":"/paper/2508.19856"},"observation_digest":"sha256:3dd3195b1a0455e85ff090767140331350e9bf5bf07f23035fb42e2845b446eb","observation_id":"8830ce8b-09bc-4675-af92-97d446d65ef9","resolution":{"observed_at":"2026-08-05T15:27:29.308951Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2006.13979","last_updated":"2020-12-15T23:19:19Z","snapshot_observed_at":"2026-08-09T01:00:21.805016Z","submitted_at":"2020-06-24T18:25:05Z","title":"Unsupervised Cross-lingual Representation Learning for Speech Recognition","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2006.13979","snapshot_observed_at":"2026-08-04T19:37:20.032674Z","title":"Unsupervised cross-lingual representation learning for speech recognition,","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2509.09204","last_updated":"2025-09-11T07:20:18Z","snapshot_observed_at":"2026-08-09T00:59:18.138223Z","submitted_at":"2025-09-11T07:20:18Z","title":"Bona fide Cross Testing Reveals Weak Spot in Audio Deepfake Detection Systems","version":1},"reference_index":41,"source":"pdf_text","source_observed_at":"2026-08-04T19:37:20.032674Z"},"links":{"cited_paper":"/paper/2006.13979","citing_paper":"/paper/2509.09204"},"observation_digest":"sha256:413349d4d8e8b95e1840dcf5924d303bd5bdf365f0b770dbd88b3f899f170c82","observation_id":"41b657f4-015d-434b-b217-61c7c4443fe8","resolution":{"observed_at":"2026-08-04T19:37:20.032674Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2006.13979","last_updated":"2020-12-15T23:19:19Z","snapshot_observed_at":"2026-08-09T01:00:21.805016Z","submitted_at":"2020-06-24T18:25:05Z","title":"Unsupervised Cross-lingual Representation Learning for Speech Recognition","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2006.13979","snapshot_observed_at":"2026-08-04T18:11:15.997955Z","title":"Unsupervised Cross-Lingual Representation Learning for Speech Recognition,","venue":null,"work_id":null,"year":2006},"citing_paper":{"arxiv_id":"2509.10116","last_updated":"2025-09-12T10:18:38Z","snapshot_observed_at":"2026-08-09T01:01:11.934533Z","submitted_at":"2025-09-12T10:18:38Z","title":"Prominence-aware automatic speech recognition for conversational speech","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-04T18:11:15.997955Z"},"links":{"cited_paper":"/paper/2006.13979","citing_paper":"/paper/2509.10116"},"observation_digest":"sha256:2263ef8c594422adb6be7f7a0bc2f2a655f1b9cb6856548e3cf1ff61f2532097","observation_id":"28d5c376-de19-43ae-80aa-0fbd64522cbc","resolution":{"observed_at":"2026-08-04T18:11:15.997955Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2006.13979","last_updated":"2020-12-15T23:19:19Z","snapshot_observed_at":"2026-08-09T01:00:21.805016Z","submitted_at":"2020-06-24T18:25:05Z","title":"Unsupervised Cross-lingual Representation Learning for Speech Recognition","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2006.13979","snapshot_observed_at":"2026-08-04T11:29:31.132461Z","title":null,"venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2510.04593","last_updated":"2026-06-08T05:49:30Z","snapshot_observed_at":"2026-08-06T08:55:28.794308Z","submitted_at":"2025-10-06T08:47:38Z","title":"UniVoice: Unifying Autoregressive ASR and Flow-Matching based TTS with Large Language Models","version":3},"reference_index":15,"source":"arxiv_source","source_observed_at":"2026-08-04T11:29:31.132461Z"},"links":{"cited_paper":"/paper/2006.13979","citing_paper":"/paper/2510.04593"},"observation_digest":"sha256:f0e39615e6716f01e5f778038387aa3e2271d854550ee9a2d00dce408310f1a5","observation_id":"721520c4-c719-475d-9685-3c36740ee176","resolution":{"observed_at":"2026-08-04T11:29:31.132461Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2006.13979","last_updated":"2020-12-15T23:19:19Z","snapshot_observed_at":"2026-08-09T01:00:21.805016Z","submitted_at":"2020-06-24T18:25:05Z","title":"Unsupervised Cross-lingual Representation Learning for Speech Recognition","version":2},"cited_work":{"arxiv_id":"2006.13979","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2006.13979","snapshot_observed_at":"2026-07-04T08:09:41.969238Z","title":"Unsupervised cross- lingual representation learning for speech recognition","venue":null,"work_id":"78a52b0a-af20-478d-8208-27050953ec4d","year":2006},"citing_paper":{"arxiv_id":"2510.10785","last_updated":"2026-01-24T16:41:09Z","snapshot_observed_at":"2026-07-06T22:32:27.698678Z","submitted_at":"2025-10-12T20:02:14Z","title":"FAC-FACodec: Controllable Zero-Shot Foreign Accent Conversion with Factorized Speech Codec","version":2},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-05-18T07:56:46.302918Z"},"links":{"cited_paper":"/paper/2006.13979","citing_paper":"/paper/2510.10785"},"observation_digest":"sha256:f1835bf0d1a39e80c7828a16d39981dc0d83175be23c6d0a2dd61bf60770a913","observation_id":"37726469-f05b-4102-ad28-7c08f9ba63ff","resolution":{"observed_at":"2026-05-18T08:01:06.824442Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2006.13979","last_updated":"2020-12-15T23:19:19Z","snapshot_observed_at":"2026-08-09T01:00:21.805016Z","submitted_at":"2020-06-24T18:25:05Z","title":"Unsupervised Cross-lingual Representation Learning for Speech Recognition","version":2},"cited_work":{"arxiv_id":"2006.13979","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2006.13979","snapshot_observed_at":"2026-07-04T08:09:41.969238Z","title":"Unsupervised cross- lingual representation learning for speech recognition","venue":null,"work_id":"78a52b0a-af20-478d-8208-27050953ec4d","year":2006},"citing_paper":{"arxiv_id":"2604.03298","last_updated":"2026-04-07T13:42:14Z","snapshot_observed_at":"2026-08-02T08:21:56.727699Z","submitted_at":"2026-03-28T16:11:56Z","title":"ENEC: A Lossless AI Model Compression Method Enabling Fast Inference on Ascend NPUs","version":2},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-05-14T21:56:38.684104Z"},"links":{"cited_paper":"/paper/2006.13979","citing_paper":"/paper/2604.03298"},"observation_digest":"sha256:cff50ae67538f415b65df4444758de6c9a15820d16d10579681182f52faa7a0d","observation_id":"56f4377f-3a06-45be-ac84-90a15a47fd14","resolution":{"observed_at":"2026-05-14T21:58:03.011495Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2006.13979","last_updated":"2020-12-15T23:19:19Z","snapshot_observed_at":"2026-08-09T01:00:21.805016Z","submitted_at":"2020-06-24T18:25:05Z","title":"Unsupervised Cross-lingual Representation Learning for Speech Recognition","version":2},"cited_work":{"arxiv_id":"2006.13979","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2006.13979","snapshot_observed_at":"2026-07-04T08:09:41.969238Z","title":"Unsupervised cross- lingual representation learning for speech recognition","venue":null,"work_id":"78a52b0a-af20-478d-8208-27050953ec4d","year":2006},"citing_paper":{"arxiv_id":"2605.01101","last_updated":"2026-05-01T21:14:45Z","snapshot_observed_at":"2026-07-06T23:14:24.758147Z","submitted_at":"2026-05-01T21:14:45Z","title":"Virtual Speech Therapist: A Clinician-in-the-Loop AI Speech Therapy Agent for Personalized and Supervised Therapy","version":1},"reference_index":47,"source":"arxiv_source","source_observed_at":"2026-05-09T19:11:40.161390Z"},"links":{"cited_paper":"/paper/2006.13979","citing_paper":"/paper/2605.01101"},"observation_digest":"sha256:c9c87695fe3c9e65eb3589f8691c4387bfe1ad5544aac26b4cbebc96d07d5792","observation_id":"ea73a65e-fc5b-49f6-9e0d-fcaea6b83d8e","resolution":{"observed_at":"2026-05-11T15:47:24.686187Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2006.13979","last_updated":"2020-12-15T23:19:19Z","snapshot_observed_at":"2026-08-09T01:00:21.805016Z","submitted_at":"2020-06-24T18:25:05Z","title":"Unsupervised Cross-lingual Representation Learning for Speech Recognition","version":2},"cited_work":{"arxiv_id":"2006.13979","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2006.13979","snapshot_observed_at":"2026-07-04T08:09:41.969238Z","title":"Unsupervised cross- lingual representation learning for speech recognition","venue":null,"work_id":"78a52b0a-af20-478d-8208-27050953ec4d","year":2006},"citing_paper":{"arxiv_id":"2606.09345","last_updated":"2026-06-08T11:12:28Z","snapshot_observed_at":"2026-08-02T23:20:23.226332Z","submitted_at":"2026-06-08T11:12:28Z","title":"A study on the impact of region specific data on the performance of Indic ASR","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-06-27T15:06:19.198758Z"},"links":{"cited_paper":"/paper/2006.13979","citing_paper":"/paper/2606.09345"},"observation_digest":"sha256:3f02b268e7c229fecf6c91616d72a80d4bdc98e33189203443dbce04a38596ad","observation_id":"3d33b2a8-1c9f-4932-af46-b461b42c97c4","resolution":{"observed_at":"2026-07-03T03:37:35.604071Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2006.13979","last_updated":"2020-12-15T23:19:19Z","snapshot_observed_at":"2026-08-09T01:00:21.805016Z","submitted_at":"2020-06-24T18:25:05Z","title":"Unsupervised Cross-lingual Representation Learning for Speech Recognition","version":2},"cited_work":{"arxiv_id":"2006.13979","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2006.13979","snapshot_observed_at":"2026-07-04T08:09:41.969238Z","title":"Unsupervised cross- lingual representation learning for speech recognition","venue":null,"work_id":"78a52b0a-af20-478d-8208-27050953ec4d","year":2006},"citing_paper":{"arxiv_id":"2606.09535","last_updated":"2026-06-08T14:18:51Z","snapshot_observed_at":"2026-07-06T23:48:53.420827Z","submitted_at":"2026-06-08T14:18:51Z","title":"Overcoming Decoder Inconsistencies in Whisper for Dravidian and Low-Resource Languages","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-06-27T16:21:39.960715Z"},"links":{"cited_paper":"/paper/2006.13979","citing_paper":"/paper/2606.09535"},"observation_digest":"sha256:848a26ae9f96d4facab138dc11e68ed8ff21ce17878bb0bd9903fe91b52d4e67","observation_id":"8c183895-9eba-4a4d-a3e4-56483739f3b4","resolution":{"observed_at":"2026-07-03T01:47:31.183833Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2006.13979","last_updated":"2020-12-15T23:19:19Z","snapshot_observed_at":"2026-08-09T01:00:21.805016Z","submitted_at":"2020-06-24T18:25:05Z","title":"Unsupervised Cross-lingual Representation Learning for Speech Recognition","version":2},"cited_work":{"arxiv_id":"2006.13979","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2006.13979","snapshot_observed_at":"2026-07-04T08:09:41.969238Z","title":"Unsupervised cross- lingual representation learning for speech recognition","venue":null,"work_id":"78a52b0a-af20-478d-8208-27050953ec4d","year":2006},"citing_paper":{"arxiv_id":"2606.11542","last_updated":"2026-06-10T01:07:32Z","snapshot_observed_at":"2026-08-04T09:55:13.088817Z","submitted_at":"2026-06-10T01:07:32Z","title":"Pretrained self-supervised speech models can recognize unseen consonants","version":1},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-06-27T10:14:47.932613Z"},"links":{"cited_paper":"/paper/2006.13979","citing_paper":"/paper/2606.11542"},"observation_digest":"sha256:3c7de02df8a51e144a20194f7677e58dc28702decc55fa6dc6231a99b8998e72","observation_id":"1ea0e690-d1bd-42d6-a64e-af5e414ccedf","resolution":{"observed_at":"2026-07-03T10:07:56.057986Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2006.13979","last_updated":"2020-12-15T23:19:19Z","snapshot_observed_at":"2026-08-09T01:00:21.805016Z","submitted_at":"2020-06-24T18:25:05Z","title":"Unsupervised Cross-lingual Representation Learning for Speech Recognition","version":2},"cited_work":{"arxiv_id":"2006.13979","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2006.13979","snapshot_observed_at":"2026-07-04T08:09:41.969238Z","title":"Unsupervised cross- lingual representation learning for speech recognition","venue":null,"work_id":"78a52b0a-af20-478d-8208-27050953ec4d","year":2006},"citing_paper":{"arxiv_id":"2606.21990","last_updated":"2026-06-20T11:02:29Z","snapshot_observed_at":"2026-08-09T11:12:50.611148Z","submitted_at":"2026-06-20T11:02:29Z","title":"Adding Robust Code-Switching Capabilities to High Performance Multilingual ASR","version":1},"reference_index":38,"source":"pdf_text","source_observed_at":"2026-06-26T12:01:57.319491Z"},"links":{"cited_paper":"/paper/2006.13979","citing_paper":"/paper/2606.21990"},"observation_digest":"sha256:0ff1ef40f5def929f146f7277a4b1aa8485fea9cb1e5442623ca4cdf6342ba1f","observation_id":"decfd35a-bd0a-432d-9585-356787c27d38","resolution":{"observed_at":"2026-07-04T08:09:41.971092Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2006.13979","last_updated":"2020-12-15T23:19:19Z","snapshot_observed_at":"2026-08-09T01:00:21.805016Z","submitted_at":"2020-06-24T18:25:05Z","title":"Unsupervised Cross-lingual Representation Learning for Speech Recognition","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2006.13979","snapshot_observed_at":"2026-07-14T13:08:11.026186Z","title":"Unsupervised cross-lingual representation learning for speech recognition,","venue":null,"work_id":null,"year":2006},"citing_paper":{"arxiv_id":"2607.10256","last_updated":"2026-07-11T10:57:24Z","snapshot_observed_at":"2026-08-08T02:51:38.807867Z","submitted_at":"2026-07-11T10:57:24Z","title":"Which Languages Transfer Best to Warlpiri? A Similarity-Based Study for Low-Resource ASR","version":1},"reference_index":38,"source":"pdf_text","source_observed_at":"2026-07-14T13:08:11.026186Z"},"links":{"cited_paper":"/paper/2006.13979","citing_paper":"/paper/2607.10256"},"observation_digest":"sha256:156bad261f2b448655e3dbae2bc7687fb0fd1e583e9ff0e01442485473bca333","observation_id":"a6500f5d-adf0-422f-b698-46425134df1c","resolution":{"observed_at":"2026-07-14T13:08:11.026186Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2006.13979","last_updated":"2020-12-15T23:19:19Z","snapshot_observed_at":"2026-08-09T01:00:21.805016Z","submitted_at":"2020-06-24T18:25:05Z","title":"Unsupervised Cross-lingual Representation Learning for Speech Recognition","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2006.13979","snapshot_observed_at":"2026-08-01T02:09:49.283745Z","title":"Unsupervised cross-lingual representation learning for speech recognition.arXiv preprint arXiv:2006.13979,","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2607.25543","last_updated":"2026-07-28T10:23:36Z","snapshot_observed_at":"2026-08-07T04:05:31.243560Z","submitted_at":"2026-07-28T10:23:36Z","title":"Less is More: Modality-Decoupling for General AIGC Audio-Video Detection","version":1},"reference_index":2023,"source":"pdf_text","source_observed_at":"2026-08-01T02:09:49.283745Z"},"links":{"cited_paper":"/paper/2006.13979","citing_paper":"/paper/2607.25543"},"observation_digest":"sha256:1aaf255b3c0f87cc28550cf2f31d019e1b3948355defad3dd78a3449caa3794a","observation_id":"c0e44047-2705-449b-9c3c-749894f32257","resolution":{"observed_at":"2026-08-01T02:09:49.283745Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"links":{"evidence":"/evidence","html":"/paper/2006.13979/citation-record","integrity":"/paper/2006.13979/integrity","json":"/paper/2006.13979/citation-record.json","paper":"/paper/2006.13979"},"outbound":[],"paper":{"arxiv_id":"2006.13979","last_updated":"2020-12-15T23:19:19Z","latest_version":2,"primary_category":"cs.CL","snapshot_observed_at":"2026-08-09T01:00:21.805016Z","submitted_at":"2020-06-24T18:25:05Z","title":"Unsupervised Cross-lingual Representation Learning for Speech Recognition"},"reference_resolution":{"displayed":0,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":0,"verified_exact":0,"verified_fuzzy":0},"total_outbound_references":0},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"thesis":"As of 9 August 2026, this Paper Citation Record lists 0 of 0 outbound references and 22 inbound Pith citation observations for arXiv:2006.13979."}