{"as_of":"2026-08-10T11:26:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:064419b68ac1fe4cece43baf2356ac18ee58feca1923e5c86e3618a9b8007bbf","coverage":[{"denominator":6,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":6,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-06T19:14:11.370246Z","state":"measured"},{"denominator":6,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":6,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-10T06:31:04.303077+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2507.06116/citation-record","integrity":"/paper/2507.06116/integrity","json":"/paper/2507.06116/citation-record.json","paper":"/paper/2507.06116"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:14:11.786260Z","title":"wav2vec 2.0: A framework for self- supervised learning of speech representations","venue":null,"work_id":"b7228910-6ede-49b9-8bc2-f989462310e0","year":2020},"citing_paper":{"arxiv_id":"2507.06116","last_updated":"2025-07-08T16:00:13Z","snapshot_observed_at":"2026-08-09T02:53:02.042572Z","submitted_at":"2025-07-08T16:00:13Z","title":"Speech Quality Assessment Model Based on Mixture of Experts: System-Level Performance Enhancement and Utterance-Level Challenge Analysis","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-06T19:14:10.817559Z"},"links":{"citing_paper":"/paper/2507.06116"},"observation_digest":"sha256:773c7f7bdddbbab011f8131431bdc38273d407796978b7bcab032ad22e976e7d","observation_id":"1dafe0bb-dc99-4971-b496-c82e5ddeda11","resolution":{"observed_at":"2026-08-06T19:14:11.877014Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:14:11.562134Z","title":"Generalization ability of mos prediction networks","venue":null,"work_id":"56ca0104-c9e9-4818-8afa-b3408284dc30","year":2022},"citing_paper":{"arxiv_id":"2507.06116","last_updated":"2025-07-08T16:00:13Z","snapshot_observed_at":"2026-08-09T02:53:02.042572Z","submitted_at":"2025-07-08T16:00:13Z","title":"Speech Quality Assessment Model Based on Mixture of Experts: System-Level Performance Enhancement and Utterance-Level Challenge Analysis","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-06T19:14:10.906772Z"},"links":{"citing_paper":"/paper/2507.06116"},"observation_digest":"sha256:86ab1ed64ff96ea51c39f4520b3c23f47026e49d6ef2bfcaae0af1056a165d3e","observation_id":"5b087b82-4a04-492e-a311-ebe5617bcdd5","resolution":{"observed_at":"2026-08-06T19:14:11.657018Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2407.05407","last_updated":"2024-07-09T07:42:51Z","snapshot_observed_at":"2026-07-06T18:42:34.958119Z","submitted_at":"2024-07-07T15:16:19Z","title":"CosyVoice: A Scalable Multilingual Zero-shot Text-to-speech Synthesizer based on Supervised Semantic Tokens","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2407.05407","snapshot_observed_at":"2026-08-06T19:14:10.969660Z","title":"Cosyvoice: A scalable multilingual zero-shot text-to- speech synthesizer based on supervised semantic tokens","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.06116","last_updated":"2025-07-08T16:00:13Z","snapshot_observed_at":"2026-08-09T02:53:02.042572Z","submitted_at":"2025-07-08T16:00:13Z","title":"Speech Quality Assessment Model Based on Mixture of Experts: System-Level Performance Enhancement and Utterance-Level Challenge Analysis","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-06T19:14:10.969660Z"},"links":{"cited_paper":"/paper/2407.05407","citing_paper":"/paper/2507.06116"},"observation_digest":"sha256:499a0beda4e3eec0f62e5c67c396b99fc1e5947f17f8ea0a47b87a1622a9fdbe","observation_id":"589760ff-a27e-4e54-9a80-86546b8e52c0","resolution":{"observed_at":"2026-08-06T19:14:10.969660Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2505.17589","last_updated":"2025-05-27T07:48:34Z","snapshot_observed_at":"2026-08-08T16:08:45.949013Z","submitted_at":"2025-05-23T07:55:21Z","title":"CosyVoice 3: Towards In-the-wild Speech Generation via Scaling-up and Post-training","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2505.17589","snapshot_observed_at":"2026-08-06T19:14:11.092792Z","title":"Cosyvoice 3: Towards in-the-wild speech generation via scaling-up and post-training","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2507.06116","last_updated":"2025-07-08T16:00:13Z","snapshot_observed_at":"2026-08-09T02:53:02.042572Z","submitted_at":"2025-07-08T16:00:13Z","title":"Speech Quality Assessment Model Based on Mixture of Experts: System-Level Performance Enhancement and Utterance-Level Challenge Analysis","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-06T19:14:11.092792Z"},"links":{"cited_paper":"/paper/2505.17589","citing_paper":"/paper/2507.06116"},"observation_digest":"sha256:487f0c852721e4cd1112525a3a22b8607bbc13d55a3269308ab3aa78b8285bf5","observation_id":"feecbaed-154d-41c9-9cef-86146d1a9a3e","resolution":{"observed_at":"2026-08-06T19:14:11.092792Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2409.03283","last_updated":"2025-04-11T07:36:53Z","snapshot_observed_at":"2026-07-06T19:10:48.519252Z","submitted_at":"2024-09-05T06:48:02Z","title":"FireRedTTS: A Foundation Text-To-Speech Framework for Industry-Level Generative Speech Applications","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2409.03283","snapshot_observed_at":"2026-08-06T19:14:11.205847Z","title":"Fireredtts: A foundation text-to-speech framework for industry-level generative speech applications","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.06116","last_updated":"2025-07-08T16:00:13Z","snapshot_observed_at":"2026-08-09T02:53:02.042572Z","submitted_at":"2025-07-08T16:00:13Z","title":"Speech Quality Assessment Model Based on Mixture of Experts: System-Level Performance Enhancement and Utterance-Level Challenge Analysis","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-06T19:14:11.205847Z"},"links":{"cited_paper":"/paper/2409.03283","citing_paper":"/paper/2507.06116"},"observation_digest":"sha256:4647e10f954b25391807e48b1fd71e58693d4fc29525eca1d79fb0ec432b3b57","observation_id":"30f9b39f-def3-4812-afda-b754c9957879","resolution":{"observed_at":"2026-08-06T19:14:11.205847Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T19:14:11.370246Z","title":"Adaptive mixtures of local experts","venue":null,"work_id":null,"year":1991},"citing_paper":{"arxiv_id":"2507.06116","last_updated":"2025-07-08T16:00:13Z","snapshot_observed_at":"2026-08-09T02:53:02.042572Z","submitted_at":"2025-07-08T16:00:13Z","title":"Speech Quality Assessment Model Based on Mixture of Experts: System-Level Performance Enhancement and Utterance-Level Challenge Analysis","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-06T19:14:11.370246Z"},"links":{"citing_paper":"/paper/2507.06116"},"observation_digest":"sha256:cc9a81bf72c1afe545a1c613d8790bde248faf7fa35893cbe3a7546cfd76e6b8","observation_id":"e3f33b4f-16bf-4ef7-871b-4e221029ce10","resolution":{"observed_at":"2026-08-06T19:14:11.370246Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"paper":{"arxiv_id":"2507.06116","last_updated":"2025-07-08T16:00:13Z","latest_version":1,"primary_category":"cs.SD","snapshot_observed_at":"2026-08-09T02:53:02.042572Z","submitted_at":"2025-07-08T16:00:13Z","title":"Speech Quality Assessment Model Based on Mixture of Experts: System-Level Performance Enhancement and Utterance-Level Challenge Analysis"},"reference_resolution":{"displayed":6,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":4,"verified_exact":0,"verified_fuzzy":2},"total_outbound_references":6},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"thesis":"As of 10 August 2026, this Paper Citation Record lists 6 of 6 outbound references and 0 inbound Pith citation observations for arXiv:2507.06116."}