{"as_of":"2026-08-18T00:58:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:3ab683170f8fdbf49a5e9e0905a8ce73a561d794559c00b7370145f8a6d3dadc","coverage":[{"denominator":30,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":30,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-05T10:36:02.710119Z","state":"measured"},{"denominator":37,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":37,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-17T06:30:58.91139+00:00","state":"measured"},{"denominator":7,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":7,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-10T04:20:41.948449Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":1,"source":"pith","source_observed_at":"2026-08-05T02:28:24.338817Z","state":"measured"}],"external_citation_measurements":[{"count":0,"observed_at":"2026-08-05T02:28:24.338817Z","source":"pith"}],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2509.03959","last_updated":"2025-09-05T06:09:30Z","snapshot_observed_at":"2026-08-07T03:15:51.661433Z","submitted_at":"2025-09-04T07:36:43Z","title":"WenetSpeech-Yue: A Large-scale Cantonese Speech Corpus with Multi-dimensional Annotation","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2509.03959","snapshot_observed_at":"2026-08-04T10:37:10.571368Z","title":"Wenetspeech-yue: A large-scale cantonese speech corpus with multi-dimensional annotation,","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2510.09344","last_updated":"2026-07-18T03:39:01Z","snapshot_observed_at":"2026-08-17T14:40:27.503211Z","submitted_at":"2025-10-10T12:56:19Z","title":"WildElder: A Chinese Elderly Speech Dataset from the Wild with Fine-Grained Manual Annotations","version":2},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-04T10:37:10.571368Z"},"links":{"cited_paper":"/paper/2509.03959","citing_paper":"/paper/2510.09344"},"observation_digest":"sha256:73d58108af4b69e4a01585bfa97fb62ff4d0c9241bed5dfa67673e483f8267c0","observation_id":"9ba67aae-634d-4fcb-81eb-ffed2b7eae79","resolution":{"observed_at":"2026-08-04T10:37:10.571368Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2509.03959","last_updated":"2025-09-05T06:09:30Z","snapshot_observed_at":"2026-08-07T03:15:51.661433Z","submitted_at":"2025-09-04T07:36:43Z","title":"WenetSpeech-Yue: A Large-scale Cantonese Speech Corpus with Multi-dimensional Annotation","version":2},"cited_work":{"arxiv_id":"2509.03959","doi":"10.48550/arxiv.2509.03959","metadata_source":"pith","pith_arxiv_id":"2509.03959","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Wenetspeech-yue: A large- scale cantonese speech corpus with multi-dimensional annota- tion","venue":"cs.SD","work_id":"6f8180cf-776c-4d58-877c-01e3584ecdc2","year":2025},"citing_paper":{"arxiv_id":"2604.00688","last_updated":"2026-04-21T12:14:57Z","snapshot_observed_at":"2026-07-06T22:51:26.754746Z","submitted_at":"2026-04-01T09:45:51Z","title":"OmniVoice: Towards Omnilingual Zero-Shot Text-to-Speech with Diffusion Language Models","version":3},"reference_index":71,"source":"pdf_text","source_observed_at":"2026-05-13T23:00:18.720371Z"},"links":{"cited_paper":"/paper/2509.03959","citing_paper":"/paper/2604.00688"},"observation_digest":"sha256:15f736faa67bb0b1307f1b9f8f0e73a7c76046b451fb65019da318bf941ab486","observation_id":"c4af5a92-dd04-4cf6-ba07-2543dd795e3b","resolution":{"observed_at":"2026-05-13T23:03:24.701893Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T16:38:12.570516+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T16:38:12.570516+00:00","source":"crossref_status_cache"},{"observed_at":"2026-08-17T16:38:12.570516+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2509.03959","last_updated":"2025-09-05T06:09:30Z","snapshot_observed_at":"2026-08-07T03:15:51.661433Z","submitted_at":"2025-09-04T07:36:43Z","title":"WenetSpeech-Yue: A Large-scale Cantonese Speech Corpus with Multi-dimensional Annotation","version":2},"cited_work":{"arxiv_id":"2509.03959","doi":"10.48550/arxiv.2509.03959","metadata_source":"pith","pith_arxiv_id":"2509.03959","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Wenetspeech-yue: A large- scale cantonese speech corpus with multi-dimensional annota- tion","venue":"cs.SD","work_id":"6f8180cf-776c-4d58-877c-01e3584ecdc2","year":2025},"citing_paper":{"arxiv_id":"2604.18105","last_updated":"2026-06-18T09:00:08Z","snapshot_observed_at":"2026-08-12T20:55:59.091609Z","submitted_at":"2026-04-20T11:21:06Z","title":"NIM4-ASR: Towards Efficient, Robust, and Customizable Real-Time LLM-Based ASR","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-05-10T03:48:14.211240Z"},"links":{"cited_paper":"/paper/2509.03959","citing_paper":"/paper/2604.18105"},"observation_digest":"sha256:f9544e431a3cb741abbf9227f65feb74309ed2f50c7d33e875fdabee067dcc58","observation_id":"a0ca6f0e-79c5-4fbc-8cae-a9e3e854ad0a","resolution":{"observed_at":"2026-05-11T12:21:05.867703Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T16:38:12.570516+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T16:38:12.570516+00:00","source":"crossref_status_cache"},{"observed_at":"2026-08-17T16:38:12.570516+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2509.03959","last_updated":"2025-09-05T06:09:30Z","snapshot_observed_at":"2026-08-07T03:15:51.661433Z","submitted_at":"2025-09-04T07:36:43Z","title":"WenetSpeech-Yue: A Large-scale Cantonese Speech Corpus with Multi-dimensional Annotation","version":2},"cited_work":{"arxiv_id":"2509.03959","doi":"10.48550/arxiv.2509.03959","metadata_source":"pith","pith_arxiv_id":"2509.03959","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Wenetspeech-yue: A large- scale cantonese speech corpus with multi-dimensional annota- tion","venue":"cs.SD","work_id":"6f8180cf-776c-4d58-877c-01e3584ecdc2","year":2025},"citing_paper":{"arxiv_id":"2604.18105","last_updated":"2026-06-18T09:00:08Z","snapshot_observed_at":"2026-08-12T20:55:59.091609Z","submitted_at":"2026-04-20T11:21:06Z","title":"NIM4-ASR: Towards Efficient, Robust, and Customizable Real-Time LLM-Based ASR","version":2},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-07-05T13:15:50.794969Z"},"links":{"cited_paper":"/paper/2509.03959","citing_paper":"/paper/2604.18105"},"observation_digest":"sha256:5d5b1b5aee8156a870c4eebf743db99747896bb3c8a08c9d68705c220cf8323d","observation_id":"4f8c7203-3f75-4e3c-b49e-f023ca52de37","resolution":{"observed_at":"2026-07-05T13:21:06.294936Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T16:38:12.570516+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T16:38:12.570516+00:00","source":"crossref_status_cache"},{"observed_at":"2026-08-17T16:38:12.570516+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2509.03959","last_updated":"2025-09-05T06:09:30Z","snapshot_observed_at":"2026-08-07T03:15:51.661433Z","submitted_at":"2025-09-04T07:36:43Z","title":"WenetSpeech-Yue: A Large-scale Cantonese Speech Corpus with Multi-dimensional Annotation","version":2},"cited_work":{"arxiv_id":"2509.03959","doi":"10.48550/arxiv.2509.03959","metadata_source":"pith","pith_arxiv_id":"2509.03959","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Wenetspeech-yue: A large- scale cantonese speech corpus with multi-dimensional annota- tion","venue":"cs.SD","work_id":"6f8180cf-776c-4d58-877c-01e3584ecdc2","year":2025},"citing_paper":{"arxiv_id":"2605.17846","last_updated":"2026-05-18T04:40:31Z","snapshot_observed_at":"2026-08-01T14:30:51.690088Z","submitted_at":"2026-05-18T04:40:31Z","title":"UrduSpeech: A 156-Hour Urdu Speech Corpus with 12-Dimension Paralinguistic Annotations","version":1},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-05-20T01:15:49.570743Z"},"links":{"cited_paper":"/paper/2509.03959","citing_paper":"/paper/2605.17846"},"observation_digest":"sha256:f307bb9c77c25d1a53d31d35e4aebd6b16104d34daa7ef398402c67128e246f7","observation_id":"45edd031-52a6-4378-a1fe-338c0fd8fbe2","resolution":{"observed_at":"2026-05-20T01:17:54.801533Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T16:38:12.570516+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T16:38:12.570516+00:00","source":"crossref_status_cache"},{"observed_at":"2026-08-17T16:38:12.570516+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2509.03959","last_updated":"2025-09-05T06:09:30Z","snapshot_observed_at":"2026-08-07T03:15:51.661433Z","submitted_at":"2025-09-04T07:36:43Z","title":"WenetSpeech-Yue: A Large-scale Cantonese Speech Corpus with Multi-dimensional Annotation","version":2},"cited_work":{"arxiv_id":"2509.03959","doi":"10.48550/arxiv.2509.03959","metadata_source":"pith","pith_arxiv_id":"2509.03959","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Wenetspeech-yue: A large- scale cantonese speech corpus with multi-dimensional annota- tion","venue":"cs.SD","work_id":"6f8180cf-776c-4d58-877c-01e3584ecdc2","year":2025},"citing_paper":{"arxiv_id":"2606.01016","last_updated":"2026-05-31T05:13:32Z","snapshot_observed_at":"2026-08-13T15:48:57.500872Z","submitted_at":"2026-05-31T05:13:32Z","title":"PolySpeech-100: A Large-Scale Benchmark for Speech Understanding Across 100+ Languages and Dialects","version":1},"reference_index":48,"source":"pdf_text","source_observed_at":"2026-06-28T17:44:07.669223Z"},"links":{"cited_paper":"/paper/2509.03959","citing_paper":"/paper/2606.01016"},"observation_digest":"sha256:82188eca25a86557647649bc1e2a2b8f580f98c3436726dc90d28d1e4dd50b60","observation_id":"79616013-f493-4f5f-8c54-0a3465b9ad56","resolution":{"observed_at":"2026-06-28T17:52:27.075003Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T16:38:12.570516+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T16:38:12.570516+00:00","source":"crossref_status_cache"},{"observed_at":"2026-08-17T16:38:12.570516+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2509.03959","last_updated":"2025-09-05T06:09:30Z","snapshot_observed_at":"2026-08-07T03:15:51.661433Z","submitted_at":"2025-09-04T07:36:43Z","title":"WenetSpeech-Yue: A Large-scale Cantonese Speech Corpus with Multi-dimensional Annotation","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2509.03959","snapshot_observed_at":"2026-08-10T04:20:41.948449Z","title":"arXiv preprint arXiv:2509.03959 , year =","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.07462","last_updated":"2026-08-07T17:57:45Z","snapshot_observed_at":"2026-08-15T23:30:18.585037Z","submitted_at":"2026-08-07T17:57:45Z","title":"SemBridge: Semantic Token Anchoring for Continuous-Latent Autoregressive Speech Generation","version":1},"reference_index":76,"source":"arxiv_source","source_observed_at":"2026-08-10T04:20:41.948449Z"},"links":{"cited_paper":"/paper/2509.03959","citing_paper":"/paper/2608.07462"},"observation_digest":"sha256:406aa37c75c26b663db5606b9bbf4d470196b3a1b57a325288648c06dcb2db96","observation_id":"1ff58e44-608d-40df-9a54-7d5045e7c5b6","resolution":{"observed_at":"2026-08-10T04:20:41.948449Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"links":{"evidence":"/evidence","html":"/paper/2509.03959/citation-record","integrity":"/paper/2509.03959/integrity","json":"/paper/2509.03959/citation-record.json","paper":"/paper/2509.03959"},"outbound":[{"citation":{"cited_paper":{"arxiv_id":"2407.04051","last_updated":"2024-07-11T02:08:35Z","snapshot_observed_at":"2026-08-16T13:36:59.551255Z","submitted_at":"2024-07-04T16:49:02Z","title":"FunAudioLLM: Voice Understanding and Generation Foundation Models for Natural Interaction Between Humans and LLMs","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2407.04051","snapshot_observed_at":"2026-08-05T10:36:00.053975Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2509.03959","last_updated":"2025-09-05T06:09:30Z","snapshot_observed_at":"2026-08-07T03:15:51.661433Z","submitted_at":"2025-09-04T07:36:43Z","title":"WenetSpeech-Yue: A Large-scale Cantonese Speech Corpus with Multi-dimensional Annotation","version":2},"reference_index":1,"source":"arxiv_source","source_observed_at":"2026-08-05T10:36:00.053975Z"},"links":{"cited_paper":"/paper/2407.04051","citing_paper":"/paper/2509.03959"},"observation_digest":"sha256:eb00c1a59d15021e8e7ea2a314abc8460c7a536670b3c72544ead4cb67237adf","observation_id":"e64faf6a-3260-42bb-800f-092f37e7ab77","resolution":{"observed_at":"2026-08-05T10:36:00.053975Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T10:36:04.208112Z","title":"Ardila, M","venue":null,"work_id":"faa068c6-827c-4a8d-9400-bd47bcae4faa","year":2020},"citing_paper":{"arxiv_id":"2509.03959","last_updated":"2025-09-05T06:09:30Z","snapshot_observed_at":"2026-08-07T03:15:51.661433Z","submitted_at":"2025-09-04T07:36:43Z","title":"WenetSpeech-Yue: A Large-scale Cantonese Speech Corpus with Multi-dimensional Annotation","version":2},"reference_index":2,"source":"arxiv_source","source_observed_at":"2026-08-05T10:36:00.123173Z"},"links":{"citing_paper":"/paper/2509.03959"},"observation_digest":"sha256:5ae6d933cc344b5160ecab5e4bc9a54e7843d5f686b4c1feaffb9e65f11c7fda","observation_id":"1f779da0-1efd-4e96-bbfc-0ffa72527da9","resolution":{"observed_at":"2026-08-05T10:36:04.211255Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T10:36:04.199315Z","title":null,"venue":null,"work_id":"4073cdca-afe4-4f06-bb09-2e929dcc9865","year":2024},"citing_paper":{"arxiv_id":"2509.03959","last_updated":"2025-09-05T06:09:30Z","snapshot_observed_at":"2026-08-07T03:15:51.661433Z","submitted_at":"2025-09-04T07:36:43Z","title":"WenetSpeech-Yue: A Large-scale Cantonese Speech Corpus with Multi-dimensional Annotation","version":2},"reference_index":3,"source":"arxiv_source","source_observed_at":"2026-08-05T10:36:00.185963Z"},"links":{"citing_paper":"/paper/2509.03959"},"observation_digest":"sha256:bb120c563add8954cd4773e447ac0a2b8d33cd1871cf738d5b6c489f2f3148e6","observation_id":"170f9447-cd11-4ef4-afe6-8fd50e522312","resolution":{"observed_at":"2026-08-05T10:36:04.202194Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T10:36:04.190452Z","title":null,"venue":null,"work_id":"6150194c-20a9-4c97-ab3a-db1bc2daa974","year":1983},"citing_paper":{"arxiv_id":"2509.03959","last_updated":"2025-09-05T06:09:30Z","snapshot_observed_at":"2026-08-07T03:15:51.661433Z","submitted_at":"2025-09-04T07:36:43Z","title":"WenetSpeech-Yue: A Large-scale Cantonese Speech Corpus with Multi-dimensional Annotation","version":2},"reference_index":4,"source":"arxiv_source","source_observed_at":"2026-08-05T10:36:00.262770Z"},"links":{"citing_paper":"/paper/2509.03959"},"observation_digest":"sha256:171f12266dc7b6afe8a1415bc0c7960627140ce25bd200c1abef9bc7a931e5cd","observation_id":"1a5a6eca-7097-409a-8264-cb8e5e17e743","resolution":{"observed_at":"2026-08-05T10:36:04.193370Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":"10.1007/978-981-96-1045-7_15","metadata_source":"openalex","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T05:30:23.456663Z","title":null,"venue":"Communications in computer and information science","work_id":"11825c48-249e-46b8-b941-3aea6f713972","year":2024},"citing_paper":{"arxiv_id":"2509.03959","last_updated":"2025-09-05T06:09:30Z","snapshot_observed_at":"2026-08-07T03:15:51.661433Z","submitted_at":"2025-09-04T07:36:43Z","title":"WenetSpeech-Yue: A Large-scale Cantonese Speech Corpus with Multi-dimensional Annotation","version":2},"reference_index":5,"source":"arxiv_source","source_observed_at":"2026-08-05T10:36:00.366707Z"},"links":{"citing_paper":"/paper/2509.03959"},"observation_digest":"sha256:4639d9c095c72d876f93467757193309352a6d9c9758f34f62ee32f9437a26fb","observation_id":"9a645bff-d2ff-48bd-9b3c-87c9061ffe21","resolution":{"observed_at":"2026-08-05T10:36:02.848327Z","resolver_source":"doi","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2412.10117","last_updated":"2024-12-25T11:54:03Z","snapshot_observed_at":"2026-08-16T06:25:22.037199Z","submitted_at":"2024-12-13T12:59:39Z","title":"CosyVoice 2: Scalable Streaming Speech Synthesis with Large Language Models","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2412.10117","snapshot_observed_at":"2026-08-05T10:36:00.479568Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2509.03959","last_updated":"2025-09-05T06:09:30Z","snapshot_observed_at":"2026-08-07T03:15:51.661433Z","submitted_at":"2025-09-04T07:36:43Z","title":"WenetSpeech-Yue: A Large-scale Cantonese Speech Corpus with Multi-dimensional Annotation","version":2},"reference_index":6,"source":"arxiv_source","source_observed_at":"2026-08-05T10:36:00.479568Z"},"links":{"cited_paper":"/paper/2412.10117","citing_paper":"/paper/2509.03959"},"observation_digest":"sha256:2effad28532751bfb9e6a468cc20ffc31a57b61e2c03fabce097f0bc03dec1cf","observation_id":"3fc3dacd-8d87-4848-bc83-2afd20cc14ff","resolution":{"observed_at":"2026-08-05T10:36:00.479568Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2505.14648","last_updated":"2025-05-20T17:36:41Z","snapshot_observed_at":"2026-08-16T17:57:32.307178Z","submitted_at":"2025-05-20T17:36:41Z","title":"Vox-Profile: A Speech Foundation Model Benchmark for Characterizing Diverse Speaker and Speech Traits","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2505.14648","snapshot_observed_at":"2026-08-05T10:36:00.618723Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2509.03959","last_updated":"2025-09-05T06:09:30Z","snapshot_observed_at":"2026-08-07T03:15:51.661433Z","submitted_at":"2025-09-04T07:36:43Z","title":"WenetSpeech-Yue: A Large-scale Cantonese Speech Corpus with Multi-dimensional Annotation","version":2},"reference_index":7,"source":"arxiv_source","source_observed_at":"2026-08-05T10:36:00.618723Z"},"links":{"cited_paper":"/paper/2505.14648","citing_paper":"/paper/2509.03959"},"observation_digest":"sha256:89c2e1235d8addfdc8be25a72d479f74975ee9238360b90400436b53d5da32b6","observation_id":"de84995d-ecf2-4d19-883a-001534d188fc","resolution":{"observed_at":"2026-08-05T10:36:00.618723Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T10:36:04.179360Z","title":null,"venue":null,"work_id":"4f825602-c8a5-41cc-8212-c6a841c9f0bc","year":1997},"citing_paper":{"arxiv_id":"2509.03959","last_updated":"2025-09-05T06:09:30Z","snapshot_observed_at":"2026-08-07T03:15:51.661433Z","submitted_at":"2025-09-04T07:36:43Z","title":"WenetSpeech-Yue: A Large-scale Cantonese Speech Corpus with Multi-dimensional Annotation","version":2},"reference_index":8,"source":"arxiv_source","source_observed_at":"2026-08-05T10:36:00.731596Z"},"links":{"citing_paper":"/paper/2509.03959"},"observation_digest":"sha256:77d276dde9ace819972bea54ef61d012689685d5f9ba2406cef67f749569d78b","observation_id":"29b95a84-a35a-4d78-8bd8-7082ae4d43d9","resolution":{"observed_at":"2026-08-05T10:36:04.182743Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T10:36:04.170292Z","title":null,"venue":null,"work_id":"be1c3239-a999-45de-9a58-70cd66cf5a83","year":2063},"citing_paper":{"arxiv_id":"2509.03959","last_updated":"2025-09-05T06:09:30Z","snapshot_observed_at":"2026-08-07T03:15:51.661433Z","submitted_at":"2025-09-04T07:36:43Z","title":"WenetSpeech-Yue: A Large-scale Cantonese Speech Corpus with Multi-dimensional Annotation","version":2},"reference_index":9,"source":"arxiv_source","source_observed_at":"2026-08-05T10:36:00.846894Z"},"links":{"citing_paper":"/paper/2509.03959"},"observation_digest":"sha256:6a694dfd6140e84ab713a5d0df8e41d4eca3f46cbea3abd540838dc7ee868579","observation_id":"1af7e0cc-f4c3-48e8-a17f-01819514fb2d","resolution":{"observed_at":"2026-08-05T10:36:04.173308Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T10:36:00.973650Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2509.03959","last_updated":"2025-09-05T06:09:30Z","snapshot_observed_at":"2026-08-07T03:15:51.661433Z","submitted_at":"2025-09-04T07:36:43Z","title":"WenetSpeech-Yue: A Large-scale Cantonese Speech Corpus with Multi-dimensional Annotation","version":2},"reference_index":10,"source":"arxiv_source","source_observed_at":"2026-08-05T10:36:00.973650Z"},"links":{"citing_paper":"/paper/2509.03959"},"observation_digest":"sha256:f4e2694b87bc9df1bb3e33e5e284a4638611f271f66bbc91c9de8608686238e8","observation_id":"361ce81d-08ef-4472-b836-c6a8498e0a07","resolution":{"observed_at":"2026-08-05T10:36:00.973650Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2502.11946","last_updated":"2025-02-18T07:29:10Z","snapshot_observed_at":"2026-08-12T20:35:16.024701Z","submitted_at":"2025-02-17T15:58:56Z","title":"Step-Audio: Unified Understanding and Generation in Intelligent Speech Interaction","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2502.11946","snapshot_observed_at":"2026-08-05T10:36:01.031769Z","title":"Huang, B","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2509.03959","last_updated":"2025-09-05T06:09:30Z","snapshot_observed_at":"2026-08-07T03:15:51.661433Z","submitted_at":"2025-09-04T07:36:43Z","title":"WenetSpeech-Yue: A Large-scale Cantonese Speech Corpus with Multi-dimensional Annotation","version":2},"reference_index":11,"source":"arxiv_source","source_observed_at":"2026-08-05T10:36:01.031769Z"},"links":{"cited_paper":"/paper/2502.11946","citing_paper":"/paper/2509.03959"},"observation_digest":"sha256:626df75241fe343766e4caadd1e8b15c6e695fa92852d410ed66deed710ccf32","observation_id":"4014b2da-1dc8-4d32-9b6b-a15ffbe387d4","resolution":{"observed_at":"2026-08-05T10:36:01.031769Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2504.18425","last_updated":"2025-04-25T15:31:46Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-04-25T15:31:46Z","title":"Kimi-Audio Technical Report","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2504.18425","snapshot_observed_at":"2026-08-05T10:36:01.100658Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2509.03959","last_updated":"2025-09-05T06:09:30Z","snapshot_observed_at":"2026-08-07T03:15:51.661433Z","submitted_at":"2025-09-04T07:36:43Z","title":"WenetSpeech-Yue: A Large-scale Cantonese Speech Corpus with Multi-dimensional Annotation","version":2},"reference_index":12,"source":"arxiv_source","source_observed_at":"2026-08-05T10:36:01.100658Z"},"links":{"cited_paper":"/paper/2504.18425","citing_paper":"/paper/2509.03959"},"observation_digest":"sha256:5cfe4b7549a94ab7ebe5e7ceb2734ca898f3b0db4b0d75d733cf796646ba2785","observation_id":"149f51c7-bb9c-4bfe-8304-e24fd130cfcd","resolution":{"observed_at":"2026-08-05T10:36:01.100658Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T10:36:04.161051Z","title":"Lavechin, M","venue":null,"work_id":"19ff214b-6883-4e39-9927-42a35e0c6e95","year":2023},"citing_paper":{"arxiv_id":"2509.03959","last_updated":"2025-09-05T06:09:30Z","snapshot_observed_at":"2026-08-07T03:15:51.661433Z","submitted_at":"2025-09-04T07:36:43Z","title":"WenetSpeech-Yue: A Large-scale Cantonese Speech Corpus with Multi-dimensional Annotation","version":2},"reference_index":13,"source":"arxiv_source","source_observed_at":"2026-08-05T10:36:01.156803Z"},"links":{"citing_paper":"/paper/2509.03959"},"observation_digest":"sha256:fb95a60821654ea90410e2043f5b6cc4fd941842f8c705425c6e8e51dc0e5f9d","observation_id":"dfa10953-3f1b-4e3b-8b3f-e9c30bfd6e5f","resolution":{"observed_at":"2026-08-05T10:36:04.163801Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2505.22069","last_updated":"2025-05-28T07:51:21Z","snapshot_observed_at":"2026-08-14T18:27:10.731993Z","submitted_at":"2025-05-28T07:51:21Z","title":"Delayed-KD: Delayed Knowledge Distillation based CTC for Low-Latency Streaming ASR","version":1},"cited_work":{"arxiv_id":"2505.22069","doi":null,"metadata_source":"pith","pith_arxiv_id":"2505.22069","snapshot_observed_at":"2026-08-05T10:36:03.025168Z","title":"Delayed-KD: Delayed Knowledge Distillation based CTC for Low-Latency Streaming ASR","venue":"cs.SD","work_id":"8fb6df9e-850c-498b-956a-fc01cea5a46d","year":2025},"citing_paper":{"arxiv_id":"2509.03959","last_updated":"2025-09-05T06:09:30Z","snapshot_observed_at":"2026-08-07T03:15:51.661433Z","submitted_at":"2025-09-04T07:36:43Z","title":"WenetSpeech-Yue: A Large-scale Cantonese Speech Corpus with Multi-dimensional Annotation","version":2},"reference_index":14,"source":"arxiv_source","source_observed_at":"2026-08-05T10:36:01.258766Z"},"links":{"cited_paper":"/paper/2505.22069","citing_paper":"/paper/2509.03959"},"observation_digest":"sha256:73edf687db8915b68f6bc94943c0fafd7038f1f25f9ea00d17708e8ab133bf61","observation_id":"0ebebc46-3bd5-4496-af2c-9b869013a41e","resolution":{"observed_at":"2026-08-05T10:36:03.088081Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T10:36:04.151556Z","title":null,"venue":null,"work_id":"9b559a51-70cc-49bb-a6af-13c06456a0fa","year":2024},"citing_paper":{"arxiv_id":"2509.03959","last_updated":"2025-09-05T06:09:30Z","snapshot_observed_at":"2026-08-07T03:15:51.661433Z","submitted_at":"2025-09-04T07:36:43Z","title":"WenetSpeech-Yue: A Large-scale Cantonese Speech Corpus with Multi-dimensional Annotation","version":2},"reference_index":15,"source":"arxiv_source","source_observed_at":"2026-08-05T10:36:01.354703Z"},"links":{"citing_paper":"/paper/2509.03959"},"observation_digest":"sha256:bdd6a0097749ae5f3b05a81b784a3643e27c8cc0c1509b0153cb078752d4178c","observation_id":"0495cfab-1ef1-4a3b-93ff-506719c2b846","resolution":{"observed_at":"2026-08-05T10:36:04.154539Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2503.20212","last_updated":"2025-03-26T04:14:03Z","snapshot_observed_at":"2026-08-16T12:46:47.029499Z","submitted_at":"2025-03-26T04:14:03Z","title":"Dolphin: A Large-Scale Automatic Speech Recognition Model for Eastern Languages","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2503.20212","snapshot_observed_at":"2026-08-05T10:36:01.410147Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2509.03959","last_updated":"2025-09-05T06:09:30Z","snapshot_observed_at":"2026-08-07T03:15:51.661433Z","submitted_at":"2025-09-04T07:36:43Z","title":"WenetSpeech-Yue: A Large-scale Cantonese Speech Corpus with Multi-dimensional Annotation","version":2},"reference_index":16,"source":"arxiv_source","source_observed_at":"2026-08-05T10:36:01.410147Z"},"links":{"cited_paper":"/paper/2503.20212","citing_paper":"/paper/2509.03959"},"observation_digest":"sha256:fcd59b6170e65f43e3e92556f6bff7485db81d79725cdc6a0bad9fcfadd2e0ee","observation_id":"c0172191-7c34-4129-b20a-b21761b78136","resolution":{"observed_at":"2026-08-05T10:36:01.410147Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T10:36:04.142224Z","title":"Panayotov, G","venue":null,"work_id":"367b1e51-65a0-4a67-b6ea-3f416111e7ac","year":2015},"citing_paper":{"arxiv_id":"2509.03959","last_updated":"2025-09-05T06:09:30Z","snapshot_observed_at":"2026-08-07T03:15:51.661433Z","submitted_at":"2025-09-04T07:36:43Z","title":"WenetSpeech-Yue: A Large-scale Cantonese Speech Corpus with Multi-dimensional Annotation","version":2},"reference_index":17,"source":"arxiv_source","source_observed_at":"2026-08-05T10:36:01.497537Z"},"links":{"citing_paper":"/paper/2509.03959"},"observation_digest":"sha256:2926b198469fa2fe1349b353cf0b1ecad90ff06ddd0076b0b9ee608b3a8d3276","observation_id":"6bc0e45a-c203-4f08-a5e4-04ebcf8eae7d","resolution":{"observed_at":"2026-08-05T10:36:04.145236Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T10:36:04.131735Z","title":"Radford, J","venue":null,"work_id":"35b6c285-3446-4971-8f12-64147e5720ac","year":2023},"citing_paper":{"arxiv_id":"2509.03959","last_updated":"2025-09-05T06:09:30Z","snapshot_observed_at":"2026-08-07T03:15:51.661433Z","submitted_at":"2025-09-04T07:36:43Z","title":"WenetSpeech-Yue: A Large-scale Cantonese Speech Corpus with Multi-dimensional Annotation","version":2},"reference_index":18,"source":"arxiv_source","source_observed_at":"2026-08-05T10:36:01.611753Z"},"links":{"citing_paper":"/paper/2509.03959"},"observation_digest":"sha256:75d89825a08d982530bedf568c03794a44145ec55d9cc14761d912c086038b02","observation_id":"c604c326-316d-47da-9d7e-040ede9a5f35","resolution":{"observed_at":"2026-08-05T10:36:04.135310Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T10:36:04.094772Z","title":null,"venue":null,"work_id":"1f723bd8-2d52-4b85-92e5-28810a494753","year":2022},"citing_paper":{"arxiv_id":"2509.03959","last_updated":"2025-09-05T06:09:30Z","snapshot_observed_at":"2026-08-07T03:15:51.661433Z","submitted_at":"2025-09-04T07:36:43Z","title":"WenetSpeech-Yue: A Large-scale Cantonese Speech Corpus with Multi-dimensional Annotation","version":2},"reference_index":19,"source":"arxiv_source","source_observed_at":"2026-08-05T10:36:01.663015Z"},"links":{"citing_paper":"/paper/2509.03959"},"observation_digest":"sha256:8fae59bed967a70d29b0f8cb091893d820bf7a7ccf36713c5535ff5969c0c1dd","observation_id":"07516982-94f2-44aa-99cf-1a4d03d8025f","resolution":{"observed_at":"2026-08-05T10:36:04.124077Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2505.22063","last_updated":"2025-05-28T07:39:25Z","snapshot_observed_at":"2026-08-15T12:41:54.265777Z","submitted_at":"2025-05-28T07:39:25Z","title":"Weakly Supervised Data Refinement and Flexible Sequence Compression for Efficient Thai LLM-based ASR","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2505.22063","snapshot_observed_at":"2026-08-05T10:36:01.741876Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2509.03959","last_updated":"2025-09-05T06:09:30Z","snapshot_observed_at":"2026-08-07T03:15:51.661433Z","submitted_at":"2025-09-04T07:36:43Z","title":"WenetSpeech-Yue: A Large-scale Cantonese Speech Corpus with Multi-dimensional Annotation","version":2},"reference_index":20,"source":"arxiv_source","source_observed_at":"2026-08-05T10:36:01.741876Z"},"links":{"cited_paper":"/paper/2505.22063","citing_paper":"/paper/2509.03959"},"observation_digest":"sha256:0d46735e9e34ed2778564a883be199d352becbfb4702e01166afca898b641792","observation_id":"d99f7832-8f17-493a-bcf7-a19de8ebd20f","resolution":{"observed_at":"2026-08-05T10:36:01.741876Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2301.02111","last_updated":"2023-01-05T15:37:15Z","snapshot_observed_at":"2026-08-07T10:11:17.796562Z","submitted_at":"2023-01-05T15:37:15Z","title":"Neural Codec Language Models are Zero-Shot Text to Speech Synthesizers","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2301.02111","snapshot_observed_at":"2026-08-05T10:36:01.815189Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2509.03959","last_updated":"2025-09-05T06:09:30Z","snapshot_observed_at":"2026-08-07T03:15:51.661433Z","submitted_at":"2025-09-04T07:36:43Z","title":"WenetSpeech-Yue: A Large-scale Cantonese Speech Corpus with Multi-dimensional Annotation","version":2},"reference_index":21,"source":"arxiv_source","source_observed_at":"2026-08-05T10:36:01.815189Z"},"links":{"cited_paper":"/paper/2301.02111","citing_paper":"/paper/2509.03959"},"observation_digest":"sha256:359e95bf8f0b68fcf035778d227fb639ab9c202b794a4c8264c4b15f601d343d","observation_id":"896d6676-1b94-453e-be33-5b385a527b2b","resolution":{"observed_at":"2026-08-05T10:36:01.815189Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T10:36:03.900651Z","title":null,"venue":null,"work_id":"ebd582d1-6c34-4dd6-b6c1-914b49808723","year":2023},"citing_paper":{"arxiv_id":"2509.03959","last_updated":"2025-09-05T06:09:30Z","snapshot_observed_at":"2026-08-07T03:15:51.661433Z","submitted_at":"2025-09-04T07:36:43Z","title":"WenetSpeech-Yue: A Large-scale Cantonese Speech Corpus with Multi-dimensional Annotation","version":2},"reference_index":22,"source":"arxiv_source","source_observed_at":"2026-08-05T10:36:01.920238Z"},"links":{"citing_paper":"/paper/2509.03959"},"observation_digest":"sha256:2499bb25dd8d09f58cd571a59ab81c59e2a99c4b0390bc896906d93e74a743ad","observation_id":"f5f6ee85-81fc-4cd6-abf0-df7e26e3bc27","resolution":{"observed_at":"2026-08-05T10:36:04.030952Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2106.05642","last_updated":"2021-12-30T00:30:30Z","snapshot_observed_at":"2026-08-16T18:18:08.262578Z","submitted_at":"2021-06-10T10:25:15Z","title":"U2++: Unified Two-pass Bidirectional End-to-end Model for Speech Recognition","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2106.05642","snapshot_observed_at":"2026-08-05T10:36:02.013721Z","title":null,"venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2509.03959","last_updated":"2025-09-05T06:09:30Z","snapshot_observed_at":"2026-08-07T03:15:51.661433Z","submitted_at":"2025-09-04T07:36:43Z","title":"WenetSpeech-Yue: A Large-scale Cantonese Speech Corpus with Multi-dimensional Annotation","version":2},"reference_index":23,"source":"arxiv_source","source_observed_at":"2026-08-05T10:36:02.013721Z"},"links":{"cited_paper":"/paper/2106.05642","citing_paper":"/paper/2509.03959"},"observation_digest":"sha256:cde396f3861da7c597788529656a69adced9dc606388928568fabd08f305911f","observation_id":"53db4fbf-e2ae-44f6-96af-3f70de58c309","resolution":{"observed_at":"2026-08-05T10:36:02.013721Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T10:36:03.743894Z","title":"Xiang, H","venue":null,"work_id":"97af828c-147a-48c1-81ab-36eb87b0ba04","year":2022},"citing_paper":{"arxiv_id":"2509.03959","last_updated":"2025-09-05T06:09:30Z","snapshot_observed_at":"2026-08-07T03:15:51.661433Z","submitted_at":"2025-09-04T07:36:43Z","title":"WenetSpeech-Yue: A Large-scale Cantonese Speech Corpus with Multi-dimensional Annotation","version":2},"reference_index":24,"source":"arxiv_source","source_observed_at":"2026-08-05T10:36:02.113083Z"},"links":{"citing_paper":"/paper/2509.03959"},"observation_digest":"sha256:a87bdbeda4e4d27726ef2f683c3b66e2eed9c561cc8f0b6b4bdf2574b6bf5fbc","observation_id":"d74e26d0-69bb-486b-8b0c-2935a05508b2","resolution":{"observed_at":"2026-08-05T10:36:03.850230Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2503.20215","last_updated":"2025-03-26T04:17:55Z","snapshot_observed_at":"2026-08-06T08:46:20.194739Z","submitted_at":"2025-03-26T04:17:55Z","title":"Qwen2.5-Omni Technical Report","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2503.20215","snapshot_observed_at":"2026-08-05T10:36:02.202465Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2509.03959","last_updated":"2025-09-05T06:09:30Z","snapshot_observed_at":"2026-08-07T03:15:51.661433Z","submitted_at":"2025-09-04T07:36:43Z","title":"WenetSpeech-Yue: A Large-scale Cantonese Speech Corpus with Multi-dimensional Annotation","version":2},"reference_index":25,"source":"arxiv_source","source_observed_at":"2026-08-05T10:36:02.202465Z"},"links":{"cited_paper":"/paper/2503.20215","citing_paper":"/paper/2509.03959"},"observation_digest":"sha256:5c7084775cd29e21517295d7b620c905cd90c153c269f83071aaedec3e94bac3","observation_id":"9ba16420-d636-4b39-af6f-fe1451789d68","resolution":{"observed_at":"2026-08-05T10:36:02.202465Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2501.14350","last_updated":"2025-01-24T09:21:41Z","snapshot_observed_at":"2026-08-16T12:58:43.219910Z","submitted_at":"2025-01-24T09:21:41Z","title":"FireRedASR: Open-Source Industrial-Grade Mandarin Speech Recognition Models from Encoder-Decoder to LLM Integration","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2501.14350","snapshot_observed_at":"2026-08-05T10:36:02.306865Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2509.03959","last_updated":"2025-09-05T06:09:30Z","snapshot_observed_at":"2026-08-07T03:15:51.661433Z","submitted_at":"2025-09-04T07:36:43Z","title":"WenetSpeech-Yue: A Large-scale Cantonese Speech Corpus with Multi-dimensional Annotation","version":2},"reference_index":26,"source":"arxiv_source","source_observed_at":"2026-08-05T10:36:02.306865Z"},"links":{"cited_paper":"/paper/2501.14350","citing_paper":"/paper/2509.03959"},"observation_digest":"sha256:fc0845d25bc1d22ac9a556c0c64983fc9e6c6e0f13fd968eeef889ee81c66b47","observation_id":"7e8d036a-9b51-4646-ae0e-bb34e373869d","resolution":{"observed_at":"2026-08-05T10:36:02.306865Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2505.09388","last_updated":"2025-05-14T13:41:34Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-05-14T13:41:34Z","title":"Qwen3 Technical Report","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2505.09388","snapshot_observed_at":"2026-08-05T10:36:02.388883Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2509.03959","last_updated":"2025-09-05T06:09:30Z","snapshot_observed_at":"2026-08-07T03:15:51.661433Z","submitted_at":"2025-09-04T07:36:43Z","title":"WenetSpeech-Yue: A Large-scale Cantonese Speech Corpus with Multi-dimensional Annotation","version":2},"reference_index":27,"source":"arxiv_source","source_observed_at":"2026-08-05T10:36:02.388883Z"},"links":{"cited_paper":"/paper/2505.09388","citing_paper":"/paper/2509.03959"},"observation_digest":"sha256:7f73a5c242fdb4cab45ef3cff45171551fec1dd46bc4c0b4884618944e8c7e57","observation_id":"285a3276-4fba-461e-afef-30598e42de9c","resolution":{"observed_at":"2026-08-05T10:36:02.388883Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2406.11546","last_updated":"2025-05-27T04:49:35Z","snapshot_observed_at":"2026-08-16T13:42:15.505318Z","submitted_at":"2024-06-17T13:44:20Z","title":"GigaSpeech 2: An Evolving, Large-Scale and Multi-domain ASR Corpus for Low-Resource Languages with Automated Crawling, Transcription and Refinement","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2406.11546","snapshot_observed_at":"2026-08-05T10:36:02.509065Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2509.03959","last_updated":"2025-09-05T06:09:30Z","snapshot_observed_at":"2026-08-07T03:15:51.661433Z","submitted_at":"2025-09-04T07:36:43Z","title":"WenetSpeech-Yue: A Large-scale Cantonese Speech Corpus with Multi-dimensional Annotation","version":2},"reference_index":28,"source":"arxiv_source","source_observed_at":"2026-08-05T10:36:02.509065Z"},"links":{"cited_paper":"/paper/2406.11546","citing_paper":"/paper/2509.03959"},"observation_digest":"sha256:87eed37459c311046ad7c69a4e9ca0a1037921d8b587189a60f56a16fdc29a8f","observation_id":"b87d2bc6-feb6-4b21-9d63-c5949de440e4","resolution":{"observed_at":"2026-08-05T10:36:02.509065Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T10:36:03.579646Z","title":null,"venue":null,"work_id":"cd77bbd0-b995-4b92-a1f5-0a00ae2d43f0","year":2022},"citing_paper":{"arxiv_id":"2509.03959","last_updated":"2025-09-05T06:09:30Z","snapshot_observed_at":"2026-08-07T03:15:51.661433Z","submitted_at":"2025-09-04T07:36:43Z","title":"WenetSpeech-Yue: A Large-scale Cantonese Speech Corpus with Multi-dimensional Annotation","version":2},"reference_index":29,"source":"arxiv_source","source_observed_at":"2026-08-05T10:36:02.610950Z"},"links":{"citing_paper":"/paper/2509.03959"},"observation_digest":"sha256:f434eb19aa8dc6fed2f61a17688d6d41a7d3e0eb4fa9990dc5557ef3284e575d","observation_id":"1c0dc945-e583-4d84-92f6-3c6bae4f499f","resolution":{"observed_at":"2026-08-05T10:36:03.686096Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T10:36:03.361751Z","title":"Zhang, H","venue":null,"work_id":"8e258be8-ff6a-417f-a610-5dbe6171812d","year":2022},"citing_paper":{"arxiv_id":"2509.03959","last_updated":"2025-09-05T06:09:30Z","snapshot_observed_at":"2026-08-07T03:15:51.661433Z","submitted_at":"2025-09-04T07:36:43Z","title":"WenetSpeech-Yue: A Large-scale Cantonese Speech Corpus with Multi-dimensional Annotation","version":2},"reference_index":30,"source":"arxiv_source","source_observed_at":"2026-08-05T10:36:02.710119Z"},"links":{"citing_paper":"/paper/2509.03959"},"observation_digest":"sha256:311acb68628a81fb0faf3768d69ee1b06d9848328f9cdc683dd85c4cf5a57f30","observation_id":"e25d1e8a-b3f3-41b8-b115-2916657694d6","resolution":{"observed_at":"2026-08-05T10:36:03.497785Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-17T06:30:58.91139+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"state":"measured"}}],"paper":{"arxiv_id":"2509.03959","last_updated":"2025-09-05T06:09:30Z","latest_version":2,"primary_category":"cs.SD","snapshot_observed_at":"2026-08-07T03:15:51.661433Z","submitted_at":"2025-09-04T07:36:43Z","title":"WenetSpeech-Yue: A Large-scale Cantonese Speech Corpus with Multi-dimensional Annotation"},"reference_resolution":{"displayed":30,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":22,"verified_exact":2,"verified_fuzzy":6},"total_outbound_references":30},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-17T06:30:58.91139+00:00","source":"crossref"},{"observed_at":"2026-08-17T06:30:54.323127+00:00","source":"retraction_watch"}],"thesis":"As of 18 August 2026, this Paper Citation Record lists 30 of 30 outbound references and 7 inbound Pith citation observations for arXiv:2509.03959."}