{"as_of":"2026-08-14T07:29:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:280e8942145ddc545e39500c7d591529b2f72b774161d0c8772697e1e0f1020e","coverage":[{"denominator":29,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":29,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-07T14:00:28.634322Z","state":"measured"},{"denominator":30,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":30,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-14T06:32:32.682623+00:00","state":"measured"},{"denominator":1,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":1,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-07T14:00:25.595644Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"pith","source_observed_at":"2026-08-07T14:00:28.778797Z","state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2505.20506","last_updated":"2025-05-26T20:15:15Z","snapshot_observed_at":"2026-08-10T00:09:16.830049Z","submitted_at":"2025-05-26T20:15:15Z","title":"ArVoice: A Multi-Speaker Dataset for Arabic Speech Synthesis","version":1},"cited_work":{"arxiv_id":"2505.20506","doi":null,"metadata_source":"pith","pith_arxiv_id":"2505.20506","snapshot_observed_at":"2026-08-07T14:00:28.778797Z","title":"ArVoice: A Multi-Speaker Dataset for Arabic Speech Synthesis","venue":"cs.CL","work_id":"c987edc2-f9b6-440a-b974-2d0799dd9ba1","year":2025},"citing_paper":{"arxiv_id":"2505.20506","last_updated":"2025-05-26T20:15:15Z","snapshot_observed_at":"2026-08-10T00:09:16.830049Z","submitted_at":"2025-05-26T20:15:15Z","title":"ArVoice: A Multi-Speaker Dataset for Arabic Speech Synthesis","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-07T14:00:25.595644Z"},"links":{"cited_paper":"/paper/2505.20506","citing_paper":"/paper/2505.20506"},"observation_digest":"sha256:1fb51bac2da2aea55aed6b9e563692320841a9c6477d3101d7be498752fa9aa2","observation_id":"b3b01c96-e5a6-431e-a440-48ac43f529a0","resolution":{"observed_at":"2026-08-07T14:00:28.939908Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}}],"links":{"evidence":"/evidence","html":"/paper/2505.20506/citation-record","integrity":"/paper/2505.20506/integrity","json":"/paper/2505.20506/citation-record.json","paper":"/paper/2505.20506"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:00:33.179880Z","title":null,"venue":null,"work_id":"c27327ee-3c46-4fd4-8f67-a02b5b9a59b5","year":null},"citing_paper":{"arxiv_id":"2505.20506","last_updated":"2025-05-26T20:15:15Z","snapshot_observed_at":"2026-08-10T00:09:16.830049Z","submitted_at":"2025-05-26T20:15:15Z","title":"ArVoice: A Multi-Speaker Dataset for Arabic Speech Synthesis","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-07T14:00:25.491796Z"},"links":{"citing_paper":"/paper/2505.20506"},"observation_digest":"sha256:677a2994b05b40e8e103276d7ebc2809b78bb53118e0ae3c4d5abab13ad3aa63","observation_id":"d9f8115b-88fa-4f4b-9ba0-7b5d2b52230e","resolution":{"observed_at":"2026-08-07T14:00:33.316583Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2505.20506","last_updated":"2025-05-26T20:15:15Z","snapshot_observed_at":"2026-08-10T00:09:16.830049Z","submitted_at":"2025-05-26T20:15:15Z","title":"ArVoice: A Multi-Speaker Dataset for Arabic Speech Synthesis","version":1},"cited_work":{"arxiv_id":"2505.20506","doi":null,"metadata_source":"pith","pith_arxiv_id":"2505.20506","snapshot_observed_at":"2026-08-07T14:00:28.778797Z","title":"ArVoice: A Multi-Speaker Dataset for Arabic Speech Synthesis","venue":"cs.CL","work_id":"c987edc2-f9b6-440a-b974-2d0799dd9ba1","year":2025},"citing_paper":{"arxiv_id":"2505.20506","last_updated":"2025-05-26T20:15:15Z","snapshot_observed_at":"2026-08-10T00:09:16.830049Z","submitted_at":"2025-05-26T20:15:15Z","title":"ArVoice: A Multi-Speaker Dataset for Arabic Speech Synthesis","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-07T14:00:25.595644Z"},"links":{"cited_paper":"/paper/2505.20506","citing_paper":"/paper/2505.20506"},"observation_digest":"sha256:1fb51bac2da2aea55aed6b9e563692320841a9c6477d3101d7be498752fa9aa2","observation_id":"b3b01c96-e5a6-431e-a440-48ac43f529a0","resolution":{"observed_at":"2026-08-07T14:00:28.939908Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:00:32.947204Z","title":"In this section, we describe each part of ArV oice and provide justifica- tion for design decisions where applicable","venue":null,"work_id":"d719299c-b67f-4fe6-8a38-b6d25fb4b090","year":2020},"citing_paper":{"arxiv_id":"2505.20506","last_updated":"2025-05-26T20:15:15Z","snapshot_observed_at":"2026-08-10T00:09:16.830049Z","submitted_at":"2025-05-26T20:15:15Z","title":"ArVoice: A Multi-Speaker Dataset for Arabic Speech Synthesis","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-07T14:00:25.719894Z"},"links":{"citing_paper":"/paper/2505.20506"},"observation_digest":"sha256:848fc223f420d2859da25fcbce75a511bb58faa0ad360db4c68e8d39395fe7f0","observation_id":"dfb1b0c9-46c1-48b4-8a93-5b50995bb039","resolution":{"observed_at":"2026-08-07T14:00:33.048002Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:00:32.762382Z","title":null,"venue":null,"work_id":"14fb0bf8-2e78-452a-83d8-0439a222ef52","year":null},"citing_paper":{"arxiv_id":"2505.20506","last_updated":"2025-05-26T20:15:15Z","snapshot_observed_at":"2026-08-10T00:09:16.830049Z","submitted_at":"2025-05-26T20:15:15Z","title":"ArVoice: A Multi-Speaker Dataset for Arabic Speech Synthesis","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-07T14:00:25.864240Z"},"links":{"citing_paper":"/paper/2505.20506"},"observation_digest":"sha256:c074481269b1cb8c4c32d7f4ebdeb524834fb306117f2976f4e92b547f7bb69e","observation_id":"53e56dec-cefd-45d0-a40e-a8f05d00d8b3","resolution":{"observed_at":"2026-08-07T14:00:32.857585Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:00:32.471533Z","title":"The dataset consists of 11 voices in total, 7 of which are human voices, and 4 are syn- thetic with parallel text","venue":null,"work_id":"2b23670a-dd2a-417d-b68b-c95dc62911d8","year":null},"citing_paper":{"arxiv_id":"2505.20506","last_updated":"2025-05-26T20:15:15Z","snapshot_observed_at":"2026-08-10T00:09:16.830049Z","submitted_at":"2025-05-26T20:15:15Z","title":"ArVoice: A Multi-Speaker Dataset for Arabic Speech Synthesis","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-07T14:00:26.057794Z"},"links":{"citing_paper":"/paper/2505.20506"},"observation_digest":"sha256:725ad9c4ca37e408bbb1ef64c482f56039312509f577036c4d6c513c8a356d73","observation_id":"504024d5-b896-4714-bf34-0f8b1f7a0a16","resolution":{"observed_at":"2026-08-07T14:00:32.522013Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:00:32.248128Z","title":"This work was partially funded by a Google research award (11/2023)","venue":null,"work_id":"1375d9bc-e4e9-4b5d-bd47-c08afe288a59","year":2023},"citing_paper":{"arxiv_id":"2505.20506","last_updated":"2025-05-26T20:15:15Z","snapshot_observed_at":"2026-08-10T00:09:16.830049Z","submitted_at":"2025-05-26T20:15:15Z","title":"ArVoice: A Multi-Speaker Dataset for Arabic Speech Synthesis","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-07T14:00:26.148273Z"},"links":{"citing_paper":"/paper/2505.20506"},"observation_digest":"sha256:91042df5e34cf0f33ade59f99f60cff546fe4255f9b83ef9e264b48e048208a3","observation_id":"027b4f30-a22f-4281-9271-061b715c7bcc","resolution":{"observed_at":"2026-08-07T14:00:32.321259Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:00:31.327269Z","title":"Cmu wilderness multilingual speech dataset,","venue":null,"work_id":"e41b9e64-cabc-485f-aa2d-2a8531140964","year":2019},"citing_paper":{"arxiv_id":"2505.20506","last_updated":"2025-05-26T20:15:15Z","snapshot_observed_at":"2026-08-10T00:09:16.830049Z","submitted_at":"2025-05-26T20:15:15Z","title":"ArVoice: A Multi-Speaker Dataset for Arabic Speech Synthesis","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-07T14:00:26.742493Z"},"links":{"citing_paper":"/paper/2505.20506"},"observation_digest":"sha256:64c73e8e699f68a79966db2f43a28a0330d1af0ae6845bc082beb07f80356037","observation_id":"ab7b15dd-9064-48a4-b593-a83a87fad8c9","resolution":{"observed_at":"2026-08-07T14:00:31.404796Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:00:26.224154Z","title":"Speech recognition challenge in the wild: Arabic mgb-3,","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2505.20506","last_updated":"2025-05-26T20:15:15Z","snapshot_observed_at":"2026-08-10T00:09:16.830049Z","submitted_at":"2025-05-26T20:15:15Z","title":"ArVoice: A Multi-Speaker Dataset for Arabic Speech Synthesis","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-07T14:00:26.224154Z"},"links":{"citing_paper":"/paper/2505.20506"},"observation_digest":"sha256:bac4dd8e924a5ccbec54f7922e1ee2207a4b9881913776616edfe7596014929f","observation_id":"86a121d7-422a-40da-86a4-9c12d8eed7b6","resolution":{"observed_at":"2026-08-07T14:00:26.224154Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:00:32.042798Z","title":"QASR: QCRI aljazeera speech resource a large scale annotated Arabic speech corpus,","venue":null,"work_id":"278d3cfd-8b2c-49ad-b90d-c5c4d9cb5e61","year":2021},"citing_paper":{"arxiv_id":"2505.20506","last_updated":"2025-05-26T20:15:15Z","snapshot_observed_at":"2026-08-10T00:09:16.830049Z","submitted_at":"2025-05-26T20:15:15Z","title":"ArVoice: A Multi-Speaker Dataset for Arabic Speech Synthesis","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-07T14:00:26.295851Z"},"links":{"citing_paper":"/paper/2505.20506"},"observation_digest":"sha256:58cc6b39e7ba62cbe689e4ba885471b76ba1acb4aae085c32f8d0f79b49b2ee3","observation_id":"5ee82de3-d52f-495f-a59d-c9f82452c7e5","resolution":{"observed_at":"2026-08-07T14:00:32.148453Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:00:31.837795Z","title":"Masc: Massive arabic speech corpus,","venue":null,"work_id":"b7bb273c-0bfb-4929-ad58-0f4832d6b0ab","year":2022},"citing_paper":{"arxiv_id":"2505.20506","last_updated":"2025-05-26T20:15:15Z","snapshot_observed_at":"2026-08-10T00:09:16.830049Z","submitted_at":"2025-05-26T20:15:15Z","title":"ArVoice: A Multi-Speaker Dataset for Arabic Speech Synthesis","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-07T14:00:26.415432Z"},"links":{"citing_paper":"/paper/2505.20506"},"observation_digest":"sha256:c473e30b6d8fd616cf663de211c9a576771bb5273f264f83d07bc23224f546cf","observation_id":"e69c566f-2255-4adc-82e5-6b2a1379ae4b","resolution":{"observed_at":"2026-08-07T14:00:31.972932Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:00:31.657701Z","title":"Diacritic recognition perfor- mance in arabic asr,","venue":null,"work_id":"e2881ad1-8f30-46b8-956b-cb3047b955bf","year":2023},"citing_paper":{"arxiv_id":"2505.20506","last_updated":"2025-05-26T20:15:15Z","snapshot_observed_at":"2026-08-10T00:09:16.830049Z","submitted_at":"2025-05-26T20:15:15Z","title":"ArVoice: A Multi-Speaker Dataset for Arabic Speech Synthesis","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-07T14:00:26.475402Z"},"links":{"citing_paper":"/paper/2505.20506"},"observation_digest":"sha256:4efb73e841a60ac922eebc3fb60e832a5e1e41af370bbb620b1b0e82f59500e6","observation_id":"053ef7d6-8f61-4a79-bc8f-df7c3f39f83b","resolution":{"observed_at":"2026-08-07T14:00:31.748774Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:00:31.499388Z","title":"Automatic restora- tion of diacritics for speech data sets,","venue":null,"work_id":"cb6da5da-ab4e-4e62-93f3-c9e86d46d480","year":2024},"citing_paper":{"arxiv_id":"2505.20506","last_updated":"2025-05-26T20:15:15Z","snapshot_observed_at":"2026-08-10T00:09:16.830049Z","submitted_at":"2025-05-26T20:15:15Z","title":"ArVoice: A Multi-Speaker Dataset for Arabic Speech Synthesis","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-07T14:00:26.595759Z"},"links":{"citing_paper":"/paper/2505.20506"},"observation_digest":"sha256:bc76d23bfae640b01ee47002f77388ed5a27601aca2caf98c95d1a46d07b879d","observation_id":"9112c2e5-c618-47fe-ad9a-eb3823aa28cf","resolution":{"observed_at":"2026-08-07T14:00:31.573106Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:00:31.488896Z","title":"Clartts: An open-source classical arabic text-to-speech corpus,","venue":null,"work_id":"9edb43c4-f465-486c-91b5-3a95aa95bedd","year":2023},"citing_paper":{"arxiv_id":"2505.20506","last_updated":"2025-05-26T20:15:15Z","snapshot_observed_at":"2026-08-10T00:09:16.830049Z","submitted_at":"2025-05-26T20:15:15Z","title":"ArVoice: A Multi-Speaker Dataset for Arabic Speech Synthesis","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-07T14:00:26.674924Z"},"links":{"citing_paper":"/paper/2505.20506"},"observation_digest":"sha256:eaa0379078bfa938cabfc0a9612d2ebd41fd96b5276ffce2f65320c08b098456","observation_id":"dd85b093-b194-469c-afc5-51f7b77b07cf","resolution":{"observed_at":"2026-08-07T14:00:31.492215Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:00:29.917331Z","title":"Robust speech recognition via large-scale weak supervision,","venue":null,"work_id":"a44baa13-4e17-4695-a4b7-2ecab4c6d39d","year":2022},"citing_paper":{"arxiv_id":"2505.20506","last_updated":"2025-05-26T20:15:15Z","snapshot_observed_at":"2026-08-10T00:09:16.830049Z","submitted_at":"2025-05-26T20:15:15Z","title":"ArVoice: A Multi-Speaker Dataset for Arabic Speech Synthesis","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-07T14:00:27.682750Z"},"links":{"citing_paper":"/paper/2505.20506"},"observation_digest":"sha256:7b499d6f6d463e3b388fb09d7f09e94ff151a54b9fbe3e70063fd12a50f00d39","observation_id":"53a911d2-71d0-4978-a8aa-4c5e4be5be7b","resolution":{"observed_at":"2026-08-07T14:00:30.089431Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:00:31.172852Z","title":"ArzEn: A speech corpus for code-switched Egyptian Arabic-English,","venue":null,"work_id":"6085e779-4248-4c6e-b712-3ec4855c1355","year":2020},"citing_paper":{"arxiv_id":"2505.20506","last_updated":"2025-05-26T20:15:15Z","snapshot_observed_at":"2026-08-10T00:09:16.830049Z","submitted_at":"2025-05-26T20:15:15Z","title":"ArVoice: A Multi-Speaker Dataset for Arabic Speech Synthesis","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-07T14:00:26.831943Z"},"links":{"citing_paper":"/paper/2505.20506"},"observation_digest":"sha256:6d465d7b8d886acd951aa54ca72e2fa7f65a6ea9292ae8d2340f3d0b5172f3bb","observation_id":"9ef20df5-6677-456b-8174-27a1f6c87197","resolution":{"observed_at":"2026-08-07T14:00:31.239238Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:00:30.983875Z","title":"V oxblink: A large scale speaker verification dataset on camera,","venue":null,"work_id":"12217cb8-2646-44d7-bef5-2140d4c7b2ab","year":2024},"citing_paper":{"arxiv_id":"2505.20506","last_updated":"2025-05-26T20:15:15Z","snapshot_observed_at":"2026-08-10T00:09:16.830049Z","submitted_at":"2025-05-26T20:15:15Z","title":"ArVoice: A Multi-Speaker Dataset for Arabic Speech Synthesis","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-07T14:00:26.916277Z"},"links":{"citing_paper":"/paper/2505.20506"},"observation_digest":"sha256:fba3e74f029a25607b4cb4605a535f52d764b9eab19e1ee18302067c154c1776","observation_id":"1e8c6ac5-a457-4e26-8358-c331085d93d5","resolution":{"observed_at":"2026-08-07T14:00:31.089268Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:00:30.848552Z","title":"Modern standard arabic phonetics for speech synthesis,","venue":null,"work_id":"04a7d3c7-24e6-4a69-980d-de2c8e9d70fb","year":null},"citing_paper":{"arxiv_id":"2505.20506","last_updated":"2025-05-26T20:15:15Z","snapshot_observed_at":"2026-08-10T00:09:16.830049Z","submitted_at":"2025-05-26T20:15:15Z","title":"ArVoice: A Multi-Speaker Dataset for Arabic Speech Synthesis","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-07T14:00:27.019303Z"},"links":{"citing_paper":"/paper/2505.20506"},"observation_digest":"sha256:6a9c68564007c529d9f17a0bf2433f0b06b40b6f036816ab0a51f843c828cc36","observation_id":"65af7c26-2278-48fa-9ce9-047a8ad23143","resolution":{"observed_at":"2026-08-07T14:00:30.900960Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2411.01156","last_updated":"2024-11-09T05:58:10Z","snapshot_observed_at":"2026-08-12T22:09:18.259155Z","submitted_at":"2024-11-02T07:04:02Z","title":"Fish-Speech: Leveraging Large Language Models for Advanced Multilingual Text-to-Speech Synthesis","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2411.01156","snapshot_observed_at":"2026-08-07T14:00:28.199944Z","title":"Fish-Speech: Leveraging large language models for advanced multilingual Text-to-Speech synthesis,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.20506","last_updated":"2025-05-26T20:15:15Z","snapshot_observed_at":"2026-08-10T00:09:16.830049Z","submitted_at":"2025-05-26T20:15:15Z","title":"ArVoice: A Multi-Speaker Dataset for Arabic Speech Synthesis","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-07T14:00:28.199944Z"},"links":{"cited_paper":"/paper/2411.01156","citing_paper":"/paper/2505.20506"},"observation_digest":"sha256:eae25d64067720ad22f8ab2fe10c9ea9397967bb864a3995ccc085fbcc7a3839","observation_id":"f620d47a-d187-42f4-93e0-6e13081bcf3c","resolution":{"observed_at":"2026-08-07T14:00:28.199944Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:00:30.529621Z","title":"Tashkeela: Novel corpus of arabic vo- calized texts, data for auto-diacritization systems,","venue":null,"work_id":"a2dbc3a3-c0b9-454d-ae8b-607e5558fcbc","year":2017},"citing_paper":{"arxiv_id":"2505.20506","last_updated":"2025-05-26T20:15:15Z","snapshot_observed_at":"2026-08-10T00:09:16.830049Z","submitted_at":"2025-05-26T20:15:15Z","title":"ArVoice: A Multi-Speaker Dataset for Arabic Speech Synthesis","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-07T14:00:27.241330Z"},"links":{"citing_paper":"/paper/2505.20506"},"observation_digest":"sha256:e1f552b703b23530e3f2d73ceed47493e6fba7faf9b8cbea3c1b3be0f9ea877c","observation_id":"ffc5d9f1-5ed1-4090-880c-fae2b0018c2f","resolution":{"observed_at":"2026-08-07T14:00:30.602628Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:00:32.614084Z","title":"We also fine-tuned KNN-VC [21], a non-parallel VC model that converts source into target speech by replacing each frame (a) VITS (w","venue":null,"work_id":"0c19a383-5a17-44cb-8a2a-268ad66dcb4d","year":null},"citing_paper":{"arxiv_id":"2505.20506","last_updated":"2025-05-26T20:15:15Z","snapshot_observed_at":"2026-08-10T00:09:16.830049Z","submitted_at":"2025-05-26T20:15:15Z","title":"ArVoice: A Multi-Speaker Dataset for Arabic Speech Synthesis","version":1},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-07T14:00:25.989216Z"},"links":{"citing_paper":"/paper/2505.20506"},"observation_digest":"sha256:6321a17a316cd143ae3df36e7787725053d6d50138a820997b5e4d17f730d755","observation_id":"4f860300-c013-4d5e-93cc-f81f59662c3d","resolution":{"observed_at":"2026-08-07T14:00:32.690016Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:00:30.362279Z","title":"Comparison of topic identification methods for arabic language,","venue":null,"work_id":"7376b31f-257e-481b-a317-71dd14fbf180","year":2005},"citing_paper":{"arxiv_id":"2505.20506","last_updated":"2025-05-26T20:15:15Z","snapshot_observed_at":"2026-08-10T00:09:16.830049Z","submitted_at":"2025-05-26T20:15:15Z","title":"ArVoice: A Multi-Speaker Dataset for Arabic Speech Synthesis","version":1},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-07T14:00:27.415410Z"},"links":{"citing_paper":"/paper/2505.20506"},"observation_digest":"sha256:8c19aa1473efb684e1fcd8fb0422e700d29ed87593f4c9290296e2a09d3a600a","observation_id":"ba7c7e28-106d-4fb4-a4b0-37b977092f62","resolution":{"observed_at":"2026-08-07T14:00:30.443055Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:00:30.241028Z","title":"STTATTS: Unified speech-to-text and text-to-speech model,","venue":null,"work_id":"3c6811ad-1853-4859-bae5-b9924a4009df","year":2024},"citing_paper":{"arxiv_id":"2505.20506","last_updated":"2025-05-26T20:15:15Z","snapshot_observed_at":"2026-08-10T00:09:16.830049Z","submitted_at":"2025-05-26T20:15:15Z","title":"ArVoice: A Multi-Speaker Dataset for Arabic Speech Synthesis","version":1},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-07T14:00:27.583427Z"},"links":{"citing_paper":"/paper/2505.20506"},"observation_digest":"sha256:4d0e471bdd32f26e32e6b1cc2c9856049215958e531a97708137397a7693e6b1","observation_id":"595761de-0765-4661-924a-299b8c43c8dc","resolution":{"observed_at":"2026-08-07T14:00:30.288429Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:00:29.602721Z","title":"ArTST: Arabic text and speech transformer,","venue":null,"work_id":"304443bb-1c2a-45ff-9dd2-e92a5ada38c0","year":2023},"citing_paper":{"arxiv_id":"2505.20506","last_updated":"2025-05-26T20:15:15Z","snapshot_observed_at":"2026-08-10T00:09:16.830049Z","submitted_at":"2025-05-26T20:15:15Z","title":"ArVoice: A Multi-Speaker Dataset for Arabic Speech Synthesis","version":1},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-07T14:00:27.836847Z"},"links":{"citing_paper":"/paper/2505.20506"},"observation_digest":"sha256:d87ae1c5ca8e46ad2e298d0a105dc1900c083e045ff58b20c0ecb006bdc21dc2","observation_id":"25212192-0b16-4a2a-86c8-024f93293fcf","resolution":{"observed_at":"2026-08-07T14:00:29.737572Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:00:29.377205Z","title":"Fast conformer with linearly scalable attention for efficient speech recognition,","venue":null,"work_id":"4ee05967-4715-44a1-9295-d012a1582cd4","year":2023},"citing_paper":{"arxiv_id":"2505.20506","last_updated":"2025-05-26T20:15:15Z","snapshot_observed_at":"2026-08-10T00:09:16.830049Z","submitted_at":"2025-05-26T20:15:15Z","title":"ArVoice: A Multi-Speaker Dataset for Arabic Speech Synthesis","version":1},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-07T14:00:27.957211Z"},"links":{"citing_paper":"/paper/2505.20506"},"observation_digest":"sha256:e689c5f672383d80e8bcdeb642627378e80471fd58f1393a35e393ee0cc64c9d","observation_id":"15679c2d-fd08-41d1-87b3-e00a189b3c50","resolution":{"observed_at":"2026-08-07T14:00:29.484852Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:00:28.076071Z","title":"Conditional variational autoencoder with adversarial learning for end-to-end text-to-speech,","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2505.20506","last_updated":"2025-05-26T20:15:15Z","snapshot_observed_at":"2026-08-10T00:09:16.830049Z","submitted_at":"2025-05-26T20:15:15Z","title":"ArVoice: A Multi-Speaker Dataset for Arabic Speech Synthesis","version":1},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-08-07T14:00:28.076071Z"},"links":{"citing_paper":"/paper/2505.20506"},"observation_digest":"sha256:bb3c5ec4dd8f1f129dbc14b23b7fa3b6327b6bf0706d33a818a42a3819c13b83","observation_id":"68242d48-3888-4ae0-a34e-f2e53dc222d1","resolution":{"observed_at":"2026-08-07T14:00:28.076071Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2309.07598","last_updated":"2023-09-15T10:47:52Z","snapshot_observed_at":"2026-08-13T10:13:48.892287Z","submitted_at":"2023-09-14T10:59:29Z","title":"AAS-VC: On the Generalization Ability of Automatic Alignment Search based Non-autoregressive Sequence-to-sequence Voice Conversion","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2309.07598","snapshot_observed_at":"2026-08-07T14:00:28.372172Z","title":"Aas-vc: On the generalization ability of automatic alignment search based non- autoregressive sequence-to-sequence voice conversion,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.20506","last_updated":"2025-05-26T20:15:15Z","snapshot_observed_at":"2026-08-10T00:09:16.830049Z","submitted_at":"2025-05-26T20:15:15Z","title":"ArVoice: A Multi-Speaker Dataset for Arabic Speech Synthesis","version":1},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-08-07T14:00:28.372172Z"},"links":{"cited_paper":"/paper/2309.07598","citing_paper":"/paper/2505.20506"},"observation_digest":"sha256:ccaa2a3a63db91c44cc2ee34b54e9d0bec3a15d9a22f59b246faa48a0ab2e63c","observation_id":"ca834ef0-2608-411c-8690-a878ddb3dd7e","resolution":{"observed_at":"2026-08-07T14:00:28.372172Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:00:29.152764Z","title":"Parallel wavegan: A fast waveform generation model based on generative adversarial net- works with multi-resolution spectrogram,","venue":null,"work_id":"557bb0f4-8651-4096-af2c-a811675386ad","year":2020},"citing_paper":{"arxiv_id":"2505.20506","last_updated":"2025-05-26T20:15:15Z","snapshot_observed_at":"2026-08-10T00:09:16.830049Z","submitted_at":"2025-05-26T20:15:15Z","title":"ArVoice: A Multi-Speaker Dataset for Arabic Speech Synthesis","version":1},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-08-07T14:00:28.521972Z"},"links":{"citing_paper":"/paper/2505.20506"},"observation_digest":"sha256:c7a2d0a7b2f447fc39b3f2700e940163b024751a673192f7e695e470c89d85bb","observation_id":"6b959bc7-994d-4b22-8339-aeb77a222c66","resolution":{"observed_at":"2026-08-07T14:00:29.248170Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:00:29.019978Z","title":"V oice conversion with just nearest neighbors,","venue":null,"work_id":"e5211009-8cd4-4d88-9448-6ebfc8406791","year":2023},"citing_paper":{"arxiv_id":"2505.20506","last_updated":"2025-05-26T20:15:15Z","snapshot_observed_at":"2026-08-10T00:09:16.830049Z","submitted_at":"2025-05-26T20:15:15Z","title":"ArVoice: A Multi-Speaker Dataset for Arabic Speech Synthesis","version":1},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-08-07T14:00:28.634322Z"},"links":{"citing_paper":"/paper/2505.20506"},"observation_digest":"sha256:8aa11e5b334dcbee5d14cb5af37cf225eceec2a80361c18ff65f8530ef904827","observation_id":"cf97cd27-ac38-4b85-983d-b3806904a469","resolution":{"observed_at":"2026-08-07T14:00:29.075673Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:00:30.681169Z","title":"Available: https://eprints.soton.ac.uk/409695/","venue":null,"work_id":"9d48fb32-bfbd-4af2-95c5-c3b5db05748c","year":null},"citing_paper":{"arxiv_id":"2505.20506","last_updated":"2025-05-26T20:15:15Z","snapshot_observed_at":"2026-08-10T00:09:16.830049Z","submitted_at":"2025-05-26T20:15:15Z","title":"ArVoice: A Multi-Speaker Dataset for Arabic Speech Synthesis","version":1},"reference_index":2016,"source":"pdf_text","source_observed_at":"2026-08-07T14:00:27.112518Z"},"links":{"citing_paper":"/paper/2505.20506"},"observation_digest":"sha256:45ce81ac24de199ea839b465fdc99faf44373be646d2ce918b46825b155dfc21","observation_id":"a26d98ca-5205-48f0-99ea-61164e471c45","resolution":{"observed_at":"2026-08-07T14:00:30.781759Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}}],"paper":{"arxiv_id":"2505.20506","last_updated":"2025-05-26T20:15:15Z","latest_version":1,"primary_category":"cs.CL","snapshot_observed_at":"2026-08-10T00:09:16.830049Z","submitted_at":"2025-05-26T20:15:15Z","title":"ArVoice: A Multi-Speaker Dataset for Arabic Speech Synthesis"},"reference_resolution":{"displayed":29,"state_counts":{"malformed_identifier":0,"metadata_mismatch":1,"parse_uncertain":0,"unresolved":6,"verified_exact":0,"verified_fuzzy":22},"total_outbound_references":29},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"thesis":"As of 14 August 2026, this Paper Citation Record lists 29 of 29 outbound references and 1 inbound Pith citation observation for arXiv:2505.20506."}