{"as_of":"2026-08-20T18:26:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:db270f8ad90cfca2d15a48ad59db78ef809e710b663cea207f3fde5f0c484a6d","coverage":[{"denominator":0,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":14,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":14,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-20T06:33:59.587034+00:00","state":"measured"},{"denominator":14,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":14,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-15T21:07:38.924508Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"arxiv_reference","source_observed_at":"2026-05-19T20:27:53.680114Z","state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"1904.08352","last_updated":"2021-07-14T07:32:49Z","snapshot_observed_at":"2026-08-19T22:40:34.709012Z","submitted_at":"2019-04-17T16:38:31Z","title":"MOSNet: Deep Learning based Objective Assessment for Voice Conversion","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1904.08352","snapshot_observed_at":"2026-08-12T05:56:42.817221Z","title":"MOSnet : Deep learning based objective assessment for voice conversion","venue":null,"work_id":null,"year":1904},"citing_paper":{"arxiv_id":"2411.19842","last_updated":"2024-11-29T16:58:02Z","snapshot_observed_at":"2026-08-20T12:50:43.814250Z","submitted_at":"2024-11-29T16:58:02Z","title":"Scaling Transformers for Low-Bitrate High-Quality Speech Coding","version":1},"reference_index":31,"source":"arxiv_source","source_observed_at":"2026-08-12T05:56:42.817221Z"},"links":{"cited_paper":"/paper/1904.08352","citing_paper":"/paper/2411.19842"},"observation_digest":"sha256:7ce74a06b21a8387855c78d8bfe0ebc006266c053c97de2459e0b2512ef596dc","observation_id":"a14080d4-9d88-469f-b961-6561f243f3f9","resolution":{"observed_at":"2026-08-12T05:56:42.817221Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1904.08352","last_updated":"2021-07-14T07:32:49Z","snapshot_observed_at":"2026-08-19T22:40:34.709012Z","submitted_at":"2019-04-17T16:38:31Z","title":"MOSNet: Deep Learning based Objective Assessment for Voice Conversion","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1904.08352","snapshot_observed_at":"2026-08-10T21:21:12.169911Z","title":"Mosnet: Deep learning based objective assessment for voice conversion,","venue":null,"work_id":null,"year":1904},"citing_paper":{"arxiv_id":"2501.05127","last_updated":"2025-01-09T10:30:58Z","snapshot_observed_at":"2026-08-19T08:29:32.805316Z","submitted_at":"2025-01-09T10:30:58Z","title":"DiffAttack: Diffusion-based Timbre-reserved Adversarial Attack in Speaker Identification","version":1},"reference_index":40,"source":"pdf_text","source_observed_at":"2026-08-10T21:21:12.169911Z"},"links":{"cited_paper":"/paper/1904.08352","citing_paper":"/paper/2501.05127"},"observation_digest":"sha256:ced342e6518499c538dc7a4714d9e4c45ced0247c03bd5b311a10f52b45bd539","observation_id":"4ee01c43-168f-4f9c-b1ca-a1a4bb7c612e","resolution":{"observed_at":"2026-08-10T21:21:12.169911Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1904.08352","last_updated":"2021-07-14T07:32:49Z","snapshot_observed_at":"2026-08-19T22:40:34.709012Z","submitted_at":"2019-04-17T16:38:31Z","title":"MOSNet: Deep Learning based Objective Assessment for Voice Conversion","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1904.08352","snapshot_observed_at":"2026-08-10T12:30:52.080500Z","title":"Mosnet: Deep learning based objective assessment for voice conversion","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2501.17202","last_updated":"2025-03-12T02:01:46Z","snapshot_observed_at":"2026-08-19T19:12:27.978893Z","submitted_at":"2025-01-27T22:47:51Z","title":"Audio Large Language Models Can Be Descriptive Speech Quality Evaluators","version":2},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-10T12:30:52.080500Z"},"links":{"cited_paper":"/paper/1904.08352","citing_paper":"/paper/2501.17202"},"observation_digest":"sha256:daf977c9f6c1c2aa7ebc7fa277fef206e8fc3918fe98e89437d47d16222ad0a7","observation_id":"e338897b-139b-4f6c-89cd-c03b2dc76461","resolution":{"observed_at":"2026-08-10T12:30:52.080500Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1904.08352","last_updated":"2021-07-14T07:32:49Z","snapshot_observed_at":"2026-08-19T22:40:34.709012Z","submitted_at":"2019-04-17T16:38:31Z","title":"MOSNet: Deep Learning based Objective Assessment for Voice Conversion","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1904.08352","snapshot_observed_at":"2026-08-08T12:30:26.197293Z","title":"Mosnet: Deep learn- ing based objective assessment for voice conversion,","venue":null,"work_id":null,"year":1904},"citing_paper":{"arxiv_id":"2502.07538","last_updated":"2025-02-13T14:21:12Z","snapshot_observed_at":"2026-08-18T04:21:44.043561Z","submitted_at":"2025-02-11T13:24:38Z","title":"Visual-based spatial audio generation system for multi-speaker environments","version":2},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-08T12:30:26.197293Z"},"links":{"cited_paper":"/paper/1904.08352","citing_paper":"/paper/2502.07538"},"observation_digest":"sha256:0540ef023bd8c2847a5cf505c4fde58c0e22f39b616c6dc39ed2f3a69f57c850","observation_id":"35500a2e-48ca-4ba1-8b71-f261a0836319","resolution":{"observed_at":"2026-08-08T12:30:26.197293Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1904.08352","last_updated":"2021-07-14T07:32:49Z","snapshot_observed_at":"2026-08-19T22:40:34.709012Z","submitted_at":"2019-04-17T16:38:31Z","title":"MOSNet: Deep Learning based Objective Assessment for Voice Conversion","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1904.08352","snapshot_observed_at":"2026-08-15T21:07:38.924508Z","title":"MosNet: Deep learning based objective assessment for voice conversion","venue":null,"work_id":null,"year":1904},"citing_paper":{"arxiv_id":"2505.10793","last_updated":"2025-05-16T02:06:25Z","snapshot_observed_at":"2026-08-20T10:52:40.332252Z","submitted_at":"2025-05-16T02:06:25Z","title":"SongEval: A Benchmark Dataset for Song Aesthetics Evaluation","version":1},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-15T21:07:38.924508Z"},"links":{"cited_paper":"/paper/1904.08352","citing_paper":"/paper/2505.10793"},"observation_digest":"sha256:029761eb49de689b16c68e0346ba5ce6d668c44d54d84460a8a5a7509ace03ec","observation_id":"f77055db-272c-4d31-98c1-a1fa46df0db5","resolution":{"observed_at":"2026-08-15T21:07:38.924508Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1904.08352","last_updated":"2021-07-14T07:32:49Z","snapshot_observed_at":"2026-08-19T22:40:34.709012Z","submitted_at":"2019-04-17T16:38:31Z","title":"MOSNet: Deep Learning based Objective Assessment for Voice Conversion","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1904.08352","snapshot_observed_at":"2026-08-07T11:44:17.680497Z","title":"MOSNET: Deep learning based objective assessment for voice conversion,","venue":null,"work_id":null,"year":1904},"citing_paper":{"arxiv_id":"2506.02082","last_updated":"2025-06-02T10:45:40Z","snapshot_observed_at":"2026-08-18T07:26:57.917011Z","submitted_at":"2025-06-02T10:45:40Z","title":"SALF-MOS: Speaker Agnostic Latent Features Downsampled for MOS Prediction","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-07T11:44:17.680497Z"},"links":{"cited_paper":"/paper/1904.08352","citing_paper":"/paper/2506.02082"},"observation_digest":"sha256:2d05793faa70fd8db0d76aa0cfd1abc7ab75006e0825fb187122575ade40c605","observation_id":"ed080602-d705-4148-958f-1e36bc095878","resolution":{"observed_at":"2026-08-07T11:44:17.680497Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1904.08352","last_updated":"2021-07-14T07:32:49Z","snapshot_observed_at":"2026-08-19T22:40:34.709012Z","submitted_at":"2019-04-17T16:38:31Z","title":"MOSNet: Deep Learning based Objective Assessment for Voice Conversion","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1904.08352","snapshot_observed_at":"2026-08-07T10:17:47.065365Z","title":null,"venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2506.10019","last_updated":"2025-06-06T11:09:46Z","snapshot_observed_at":"2026-08-17T19:45:22.860227Z","submitted_at":"2025-06-06T11:09:46Z","title":"A Survey of Automatic Evaluation Methods on Text, Visual and Speech Generations","version":1},"reference_index":229,"source":"pdf_text","source_observed_at":"2026-08-07T10:17:47.065365Z"},"links":{"cited_paper":"/paper/1904.08352","citing_paper":"/paper/2506.10019"},"observation_digest":"sha256:b530b46519293ba7951f3bc998ad9583e68d877be5c0a3dc328af3ed5c413518","observation_id":"26cf5952-8d46-4441-89ac-e9ce9fafdf9e","resolution":{"observed_at":"2026-08-07T10:17:47.065365Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1904.08352","last_updated":"2021-07-14T07:32:49Z","snapshot_observed_at":"2026-08-19T22:40:34.709012Z","submitted_at":"2019-04-17T16:38:31Z","title":"MOSNet: Deep Learning based Objective Assessment for Voice Conversion","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1904.08352","snapshot_observed_at":"2026-08-06T16:47:56.555197Z","title":null,"venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2507.12705","last_updated":"2025-07-17T00:39:18Z","snapshot_observed_at":"2026-08-13T13:24:03.399635Z","submitted_at":"2025-07-17T00:39:18Z","title":"AudioJudge: Understanding What Works in Large Audio Model Based Speech Evaluation","version":1},"reference_index":28,"source":"arxiv_source","source_observed_at":"2026-08-06T16:47:56.555197Z"},"links":{"cited_paper":"/paper/1904.08352","citing_paper":"/paper/2507.12705"},"observation_digest":"sha256:72cd9fdcf09ebec280b977adb3fab0e3bf8424c43c60a38d58f3a3490c0e96b3","observation_id":"f4941141-288b-45c5-a6f4-b395f75250d2","resolution":{"observed_at":"2026-08-06T16:47:56.555197Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1904.08352","last_updated":"2021-07-14T07:32:49Z","snapshot_observed_at":"2026-08-19T22:40:34.709012Z","submitted_at":"2019-04-17T16:38:31Z","title":"MOSNet: Deep Learning based Objective Assessment for Voice Conversion","version":3},"cited_work":{"arxiv_id":"1904.08352","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"1904.08352","snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Mosnet: Deep learning based objective assessment for voice conversion.arXiv preprint arXiv:1904.08352","venue":null,"work_id":"1792edb2-db95-4824-995d-b477d7de145e","year":1904},"citing_paper":{"arxiv_id":"2604.08562","last_updated":"2026-03-17T16:07:15Z","snapshot_observed_at":"2026-08-15T03:13:18.639877Z","submitted_at":"2026-03-17T16:07:15Z","title":"Neural networks for Text-to-Speech evaluation","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-05-15T09:46:26.884551Z"},"links":{"cited_paper":"/paper/1904.08352","citing_paper":"/paper/2604.08562"},"observation_digest":"sha256:6d320f45d54c1a95215ac4fae3e255446ce7ed86373ea60d539fe1fc36236749","observation_id":"10b34981-1018-4791-b2c0-c0e76fd61647","resolution":{"observed_at":"2026-05-15T09:49:54.671517Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1904.08352","last_updated":"2021-07-14T07:32:49Z","snapshot_observed_at":"2026-08-19T22:40:34.709012Z","submitted_at":"2019-04-17T16:38:31Z","title":"MOSNet: Deep Learning based Objective Assessment for Voice Conversion","version":3},"cited_work":{"arxiv_id":"1904.08352","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"1904.08352","snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Mosnet: Deep learning based objective assessment for voice conversion.arXiv preprint arXiv:1904.08352","venue":null,"work_id":"1792edb2-db95-4824-995d-b477d7de145e","year":1904},"citing_paper":{"arxiv_id":"2605.00861","last_updated":"2026-04-21T10:34:41Z","snapshot_observed_at":"2026-07-06T23:14:11.211164Z","submitted_at":"2026-04-21T10:34:41Z","title":"Voice Mapping of Text-to-Speech Systems: A Metric-Based Approach for Voice Quality Assessment","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-05-10T01:07:50.243903Z"},"links":{"cited_paper":"/paper/1904.08352","citing_paper":"/paper/2605.00861"},"observation_digest":"sha256:13071ad9cc961627baaac3345c618fbce55cf5709981315d66b181a4cd00aafb","observation_id":"fa24a8eb-4b44-4c14-9ecb-1da1c7e80c75","resolution":{"observed_at":"2026-05-10T01:10:09.302242Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1904.08352","last_updated":"2021-07-14T07:32:49Z","snapshot_observed_at":"2026-08-19T22:40:34.709012Z","submitted_at":"2019-04-17T16:38:31Z","title":"MOSNet: Deep Learning based Objective Assessment for Voice Conversion","version":3},"cited_work":{"arxiv_id":"1904.08352","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"1904.08352","snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Mosnet: Deep learning based objective assessment for voice conversion.arXiv preprint arXiv:1904.08352","venue":null,"work_id":"1792edb2-db95-4824-995d-b477d7de145e","year":1904},"citing_paper":{"arxiv_id":"2605.16681","last_updated":"2026-08-16T00:07:27Z","snapshot_observed_at":"2026-08-20T18:11:50.322995Z","submitted_at":"2026-05-15T22:34:52Z","title":"A Survey of Advancing Audio Super-Resolution and Bandwidth Extension from Discriminative to Generative Models","version":1},"reference_index":41,"source":"pdf_text","source_observed_at":"2026-05-19T20:26:59.049472Z"},"links":{"cited_paper":"/paper/1904.08352","citing_paper":"/paper/2605.16681"},"observation_digest":"sha256:d1cf8f4a04676363e386b371e87dd0dfe2c64a1f82c1d70cc070b85f3b005d37","observation_id":"366c75ff-6f51-404e-b485-900a1c3b501d","resolution":{"observed_at":"2026-05-19T20:27:53.684089Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1904.08352","last_updated":"2021-07-14T07:32:49Z","snapshot_observed_at":"2026-08-19T22:40:34.709012Z","submitted_at":"2019-04-17T16:38:31Z","title":"MOSNet: Deep Learning based Objective Assessment for Voice Conversion","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1904.08352","snapshot_observed_at":"2026-07-30T11:48:49.502742Z","title":null,"venue":null,"work_id":null,"year":1904},"citing_paper":{"arxiv_id":"2607.23811","last_updated":"2026-08-17T17:56:26Z","snapshot_observed_at":"2026-08-20T18:15:23.905560Z","submitted_at":"2026-07-26T19:20:01Z","title":"Memory Efficient Audio Synthesis with Decoupled Temporal Depth Diffusion Transformers","version":1},"reference_index":2019,"source":"pdf_text","source_observed_at":"2026-07-30T11:48:49.502742Z"},"links":{"cited_paper":"/paper/1904.08352","citing_paper":"/paper/2607.23811"},"observation_digest":"sha256:135610ede15c53033ae0731d0015bf78afbe4e8c7141f5a6b18b747cc995d848","observation_id":"6e732adf-c477-44e6-9729-136ae39cab44","resolution":{"observed_at":"2026-07-30T11:48:49.502742Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1904.08352","last_updated":"2021-07-14T07:32:49Z","snapshot_observed_at":"2026-08-19T22:40:34.709012Z","submitted_at":"2019-04-17T16:38:31Z","title":"MOSNet: Deep Learning based Objective Assessment for Voice Conversion","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1904.08352","snapshot_observed_at":"2026-08-10T21:57:54.730415Z","title":"arXiv preprint arXiv:1904.08352 , year=","venue":null,"work_id":null,"year":1904},"citing_paper":{"arxiv_id":"2608.06718","last_updated":"2026-08-12T18:57:42Z","snapshot_observed_at":"2026-08-16T23:09:55.785376Z","submitted_at":"2026-08-07T02:24:12Z","title":"Do Audio Language Models Use Paralinguistic Evidence? Counterfactual Audits for Response Evaluation","version":1},"reference_index":32,"source":"arxiv_source","source_observed_at":"2026-08-10T21:57:54.730415Z"},"links":{"cited_paper":"/paper/1904.08352","citing_paper":"/paper/2608.06718"},"observation_digest":"sha256:1d89b0537443df1fffc8a8183010c83f8d68249ea42987fec5b4372e5f7b4aa2","observation_id":"b7e114da-fed1-48fc-a2d2-c61d0c4e4166","resolution":{"observed_at":"2026-08-10T21:57:54.730415Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1904.08352","last_updated":"2021-07-14T07:32:49Z","snapshot_observed_at":"2026-08-19T22:40:34.709012Z","submitted_at":"2019-04-17T16:38:31Z","title":"MOSNet: Deep Learning based Objective Assessment for Voice Conversion","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1904.08352","snapshot_observed_at":"2026-08-14T04:43:45.022396Z","title":"arXiv preprint arXiv:1904.08352 , year=","venue":null,"work_id":null,"year":1904},"citing_paper":{"arxiv_id":"2608.06718","last_updated":"2026-08-12T18:57:42Z","snapshot_observed_at":"2026-08-16T23:09:55.785376Z","submitted_at":"2026-08-07T02:24:12Z","title":"Do Audio Language Models Use Paralinguistic Evidence? Counterfactual Audits for Response Evaluation","version":2},"reference_index":30,"source":"arxiv_source","source_observed_at":"2026-08-14T04:43:45.022396Z"},"links":{"cited_paper":"/paper/1904.08352","citing_paper":"/paper/2608.06718"},"observation_digest":"sha256:423092ba9fba027e3b58ad40b05897f541a3e148b9e86e1de93c214e9edb1744","observation_id":"778db9d8-3f12-4828-bdcb-562d76064021","resolution":{"observed_at":"2026-08-14T04:43:45.022396Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"links":{"evidence":"/evidence","html":"/paper/1904.08352/citation-record","integrity":"/paper/1904.08352/integrity","json":"/paper/1904.08352/citation-record.json","paper":"/paper/1904.08352"},"outbound":[],"paper":{"arxiv_id":"1904.08352","last_updated":"2021-07-14T07:32:49Z","latest_version":3,"primary_category":"cs.SD","snapshot_observed_at":"2026-08-19T22:40:34.709012Z","submitted_at":"2019-04-17T16:38:31Z","title":"MOSNet: Deep Learning based Objective Assessment for Voice Conversion"},"reference_resolution":{"displayed":0,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":0,"verified_exact":0,"verified_fuzzy":0},"total_outbound_references":0},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"thesis":"As of 20 August 2026, this Paper Citation Record lists 0 of 0 outbound references and 14 inbound Pith citation observations for arXiv:1904.08352."}