{"as_of":"2026-08-10T10:52:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:f50d00d5af01710253e15a074f3de5fcfbe60c3d56364402b66b44df386a2f5d","coverage":[{"denominator":37,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":37,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-06T20:57:20.669235Z","state":"measured"},{"denominator":38,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":38,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-10T06:31:04.303077+00:00","state":"measured"},{"denominator":1,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":1,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-06T20:57:17.819137Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"pith","source_observed_at":"2026-08-06T20:57:20.782941Z","state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2507.01356","last_updated":"2025-07-02T04:47:43Z","snapshot_observed_at":"2026-08-09T10:25:51.055237Z","submitted_at":"2025-07-02T04:47:43Z","title":"Voice Conversion for Likability Control via Automated Rating of Speech Synthesis Corpora","version":1},"cited_work":{"arxiv_id":"2507.01356","doi":null,"metadata_source":"pith","pith_arxiv_id":"2507.01356","snapshot_observed_at":"2026-08-06T20:57:20.782941Z","title":"Voice Conversion for Likability Control via Automated Rating of Speech Synthesis Corpora","venue":"eess.AS","work_id":"c3c2e1fb-6bb2-4ec8-b986-c7424c8e5c7c","year":2025},"citing_paper":{"arxiv_id":"2507.01356","last_updated":"2025-07-02T04:47:43Z","snapshot_observed_at":"2026-08-09T10:25:51.055237Z","submitted_at":"2025-07-02T04:47:43Z","title":"Voice Conversion for Likability Control via Automated Rating of Speech Synthesis Corpora","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-06T20:57:17.819137Z"},"links":{"cited_paper":"/paper/2507.01356","citing_paper":"/paper/2507.01356"},"observation_digest":"sha256:179f71a02863e6853e1d769cdaf493151a5fef6c0279c66c08c1e21dae82d314","observation_id":"423ff55b-102e-4eaa-b1df-80d7b6bc5991","resolution":{"observed_at":"2026-08-06T20:57:20.851772Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}}],"links":{"evidence":"/evidence","html":"/paper/2507.01356/citation-record","integrity":"/paper/2507.01356/integrity","json":"/paper/2507.01356/citation-record.json","paper":"/paper/2507.01356"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T20:57:25.905683Z","title":"Numerous studies have explored methods for controlling paralinguistic and non-linguistic fea- tures in synthesized speech","venue":null,"work_id":"86e07198-1a58-41d7-b7ca-b1bf2ab12c36","year":null},"citing_paper":{"arxiv_id":"2507.01356","last_updated":"2025-07-02T04:47:43Z","snapshot_observed_at":"2026-08-09T10:25:51.055237Z","submitted_at":"2025-07-02T04:47:43Z","title":"Voice Conversion for Likability Control via Automated Rating of Speech Synthesis Corpora","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-06T20:57:17.759157Z"},"links":{"citing_paper":"/paper/2507.01356"},"observation_digest":"sha256:c2f74c6e54306bc02ffe407e69bfacb70cdfe7f2cc49be81249c69b0522b2398","observation_id":"535c37c9-22ae-45e0-9668-dc3d8b1a5ddb","resolution":{"observed_at":"2026-08-06T20:57:26.049903Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2507.01356","last_updated":"2025-07-02T04:47:43Z","snapshot_observed_at":"2026-08-09T10:25:51.055237Z","submitted_at":"2025-07-02T04:47:43Z","title":"Voice Conversion for Likability Control via Automated Rating of Speech Synthesis Corpora","version":1},"cited_work":{"arxiv_id":"2507.01356","doi":null,"metadata_source":"pith","pith_arxiv_id":"2507.01356","snapshot_observed_at":"2026-08-06T20:57:20.782941Z","title":"Voice Conversion for Likability Control via Automated Rating of Speech Synthesis Corpora","venue":"eess.AS","work_id":"c3c2e1fb-6bb2-4ec8-b986-c7424c8e5c7c","year":2025},"citing_paper":{"arxiv_id":"2507.01356","last_updated":"2025-07-02T04:47:43Z","snapshot_observed_at":"2026-08-09T10:25:51.055237Z","submitted_at":"2025-07-02T04:47:43Z","title":"Voice Conversion for Likability Control via Automated Rating of Speech Synthesis Corpora","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-06T20:57:17.819137Z"},"links":{"cited_paper":"/paper/2507.01356","citing_paper":"/paper/2507.01356"},"observation_digest":"sha256:179f71a02863e6853e1d769cdaf493151a5fef6c0279c66c08c1e21dae82d314","observation_id":"423ff55b-102e-4eaa-b1df-80d7b6bc5991","resolution":{"observed_at":"2026-08-06T20:57:20.851772Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T20:57:25.687306Z","title":"Figure 2 depicts the archi- tecture of the method","venue":null,"work_id":"4aa56169-08ad-4c86-8f23-dfea43a0f9ea","year":null},"citing_paper":{"arxiv_id":"2507.01356","last_updated":"2025-07-02T04:47:43Z","snapshot_observed_at":"2026-08-09T10:25:51.055237Z","submitted_at":"2025-07-02T04:47:43Z","title":"Voice Conversion for Likability Control via Automated Rating of Speech Synthesis Corpora","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-06T20:57:17.896873Z"},"links":{"citing_paper":"/paper/2507.01356"},"observation_digest":"sha256:ab7d5ff81d08609dad4ab9cde5cf253c801069b17d72d4e92f6e18924020da0d","observation_id":"2fdbda74-157f-44b0-b9eb-e71c64fd4c00","resolution":{"observed_at":"2026-08-06T20:57:25.791514Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T20:57:25.563647Z","title":"liked” or “disliked","venue":null,"work_id":"71c9aa55-a41a-4020-a1d3-8cdeac69605b","year":null},"citing_paper":{"arxiv_id":"2507.01356","last_updated":"2025-07-02T04:47:43Z","snapshot_observed_at":"2026-08-09T10:25:51.055237Z","submitted_at":"2025-07-02T04:47:43Z","title":"Voice Conversion for Likability Control via Automated Rating of Speech Synthesis Corpora","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-06T20:57:17.978948Z"},"links":{"citing_paper":"/paper/2507.01356"},"observation_digest":"sha256:6b7aed548bef95331856cb11612427d09e4d2d6d6ef8be3781570688d90a9fb0","observation_id":"fb2bd482-05c7-4404-9516-dd9e7ded2a71","resolution":{"observed_at":"2026-08-06T20:57:25.601921Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T20:57:25.265824Z","title":null,"venue":null,"work_id":"f8af6237-b5c0-4778-bb2f-f0a417ba171a","year":null},"citing_paper":{"arxiv_id":"2507.01356","last_updated":"2025-07-02T04:47:43Z","snapshot_observed_at":"2026-08-09T10:25:51.055237Z","submitted_at":"2025-07-02T04:47:43Z","title":"Voice Conversion for Likability Control via Automated Rating of Speech Synthesis Corpora","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-06T20:57:18.083775Z"},"links":{"citing_paper":"/paper/2507.01356"},"observation_digest":"sha256:83e3b422f8b1177d5e4b1fc853b9d8abc80a083f0073ea754db6bb48ed746fc9","observation_id":"a57a16a3-6f30-43f0-9ca0-33c3a8fa5bd4","resolution":{"observed_at":"2026-08-06T20:57:25.439365Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T20:57:25.095483Z","title":null,"venue":null,"work_id":"89e04ec0-5077-4690-8950-bae25db7a1c9","year":null},"citing_paper":{"arxiv_id":"2507.01356","last_updated":"2025-07-02T04:47:43Z","snapshot_observed_at":"2026-08-09T10:25:51.055237Z","submitted_at":"2025-07-02T04:47:43Z","title":"Voice Conversion for Likability Control via Automated Rating of Speech Synthesis Corpora","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-06T20:57:18.172294Z"},"links":{"citing_paper":"/paper/2507.01356"},"observation_digest":"sha256:71f531bf2e27644aa475483cb7bfaf2e663e6c0848da0bf116960d555dcccb18","observation_id":"370be4f8-3b13-4008-b0b8-7ebed7ebb358","resolution":{"observed_at":"2026-08-06T20:57:25.179895Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T20:57:25.046620Z","title":"R&D on Generative AI Foundation Models for the Physical Domain","venue":null,"work_id":"dbfd5dc4-cbab-4bbc-bce4-c343027b5456","year":null},"citing_paper":{"arxiv_id":"2507.01356","last_updated":"2025-07-02T04:47:43Z","snapshot_observed_at":"2026-08-09T10:25:51.055237Z","submitted_at":"2025-07-02T04:47:43Z","title":"Voice Conversion for Likability Control via Automated Rating of Speech Synthesis Corpora","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-06T20:57:18.257998Z"},"links":{"citing_paper":"/paper/2507.01356"},"observation_digest":"sha256:57c463f9fc32f3b14fdd76bbd224af48be61cd374a7a2f0174b9459b8d7b2592","observation_id":"0cf5b4bd-7a76-4f7e-a785-e3def54eba6c","resolution":{"observed_at":"2026-08-06T20:57:25.054700Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T20:57:24.895646Z","title":"Prosody, models, and spontaneous speech,","venue":null,"work_id":"a8238fb2-4b28-4591-9100-8aceee3ea133","year":1997},"citing_paper":{"arxiv_id":"2507.01356","last_updated":"2025-07-02T04:47:43Z","snapshot_observed_at":"2026-08-09T10:25:51.055237Z","submitted_at":"2025-07-02T04:47:43Z","title":"Voice Conversion for Likability Control via Automated Rating of Speech Synthesis Corpora","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-06T20:57:18.344686Z"},"links":{"citing_paper":"/paper/2507.01356"},"observation_digest":"sha256:706163af7503c0b3598f0aad149e6e4008befc2b1b189c73187338fc06f4d1df","observation_id":"a872e3b5-6f57-4625-b344-43846a00b9f7","resolution":{"observed_at":"2026-08-06T20:57:24.977414Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T20:57:24.702714Z","title":"Style tokens: Un- supervised style modeling, control and transfer in end-to-end speech synthesis,","venue":null,"work_id":"b8c10362-8641-4146-af85-63eff55ab64d","year":2018},"citing_paper":{"arxiv_id":"2507.01356","last_updated":"2025-07-02T04:47:43Z","snapshot_observed_at":"2026-08-09T10:25:51.055237Z","submitted_at":"2025-07-02T04:47:43Z","title":"Voice Conversion for Likability Control via Automated Rating of Speech Synthesis Corpora","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-06T20:57:18.432347Z"},"links":{"citing_paper":"/paper/2507.01356"},"observation_digest":"sha256:863c5714df3402c871f6081aaf6c13defbbc7e27e994cfb168950c44f1f65b50","observation_id":"d482a62b-fcba-4d29-95e7-c4e4f0c5ea69","resolution":{"observed_at":"2026-08-06T20:57:24.801704Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T20:57:24.543734Z","title":"Deep learning-based expressive speech synthesis: A systematic review of approaches, challenges, and resources,","venue":null,"work_id":"46f7379e-374f-4ef2-bd41-1530812ae6ab","year":2024},"citing_paper":{"arxiv_id":"2507.01356","last_updated":"2025-07-02T04:47:43Z","snapshot_observed_at":"2026-08-09T10:25:51.055237Z","submitted_at":"2025-07-02T04:47:43Z","title":"Voice Conversion for Likability Control via Automated Rating of Speech Synthesis Corpora","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-06T20:57:18.539331Z"},"links":{"citing_paper":"/paper/2507.01356"},"observation_digest":"sha256:a3330c256403d47769b3f8959a548f36e31b66a5171cae140550cc5714e9c67f","observation_id":"ea34e2bd-9e8c-43e9-aa2b-b5759c0aefc5","resolution":{"observed_at":"2026-08-06T20:57:24.613299Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T20:57:24.454977Z","title":"V oice transformation: A survey,","venue":null,"work_id":"13c62909-e884-4f74-b47d-4efb76e36365","year":2009},"citing_paper":{"arxiv_id":"2507.01356","last_updated":"2025-07-02T04:47:43Z","snapshot_observed_at":"2026-08-09T10:25:51.055237Z","submitted_at":"2025-07-02T04:47:43Z","title":"Voice Conversion for Likability Control via Automated Rating of Speech Synthesis Corpora","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-06T20:57:18.608473Z"},"links":{"citing_paper":"/paper/2507.01356"},"observation_digest":"sha256:2e4f54e36254aaeec6839c8cb0a1b4c996ab66df7f235f8fcc81c4e421e04d7f","observation_id":"84652c26-e93b-452f-bd25-a0845fd62c3b","resolution":{"observed_at":"2026-08-06T20:57:24.496912Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T20:57:24.315590Z","title":"PromptTTS: Controllable text-to-speech with text descriptions,","venue":null,"work_id":"147f268d-57a7-4abc-9d57-0aaf23ca5073","year":2023},"citing_paper":{"arxiv_id":"2507.01356","last_updated":"2025-07-02T04:47:43Z","snapshot_observed_at":"2026-08-09T10:25:51.055237Z","submitted_at":"2025-07-02T04:47:43Z","title":"Voice Conversion for Likability Control via Automated Rating of Speech Synthesis Corpora","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-06T20:57:18.686636Z"},"links":{"citing_paper":"/paper/2507.01356"},"observation_digest":"sha256:f0faa8371dd176962438f5c5b12757c063a72514fc7afaef52b51c838d84b5e2","observation_id":"3636a2a3-45fb-4e50-9aff-8e8fc1847c58","resolution":{"observed_at":"2026-08-06T20:57:24.384444Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T20:57:24.213424Z","title":"Weiss, J","venue":null,"work_id":"1553d12d-4559-4043-84da-1e4fe960002e","year":2020},"citing_paper":{"arxiv_id":"2507.01356","last_updated":"2025-07-02T04:47:43Z","snapshot_observed_at":"2026-08-09T10:25:51.055237Z","submitted_at":"2025-07-02T04:47:43Z","title":"Voice Conversion for Likability Control via Automated Rating of Speech Synthesis Corpora","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-06T20:57:18.785788Z"},"links":{"citing_paper":"/paper/2507.01356"},"observation_digest":"sha256:53451764e51145b5862c3e0f7e1e8713ae87a19ce4a20ac0ad03cf559de4e413","observation_id":"bd221b50-258b-4ac9-a342-eaac7f730f8c","resolution":{"observed_at":"2026-08-06T20:57:24.267246Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T20:57:24.089584Z","title":"V ocal and visual attractiveness are related in women,","venue":null,"work_id":"4d016656-3d05-471a-a521-010ed2ceb649","year":2003},"citing_paper":{"arxiv_id":"2507.01356","last_updated":"2025-07-02T04:47:43Z","snapshot_observed_at":"2026-08-09T10:25:51.055237Z","submitted_at":"2025-07-02T04:47:43Z","title":"Voice Conversion for Likability Control via Automated Rating of Speech Synthesis Corpora","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-06T20:57:18.883811Z"},"links":{"citing_paper":"/paper/2507.01356"},"observation_digest":"sha256:defb7e1d678670fe600f32222ca1a1f375f8046c1732794f552d930bf6ccfb55","observation_id":"a0170a0c-97ef-4edd-a777-52ac7661b418","resolution":{"observed_at":"2026-08-06T20:57:24.139388Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T20:57:23.950224Z","title":"V ocal characteristics of presidential candidates can predict the outcome of actual elec- tions,","venue":null,"work_id":"9588c88c-ca8d-4917-b3b0-17e06793de30","year":2017},"citing_paper":{"arxiv_id":"2507.01356","last_updated":"2025-07-02T04:47:43Z","snapshot_observed_at":"2026-08-09T10:25:51.055237Z","submitted_at":"2025-07-02T04:47:43Z","title":"Voice Conversion for Likability Control via Automated Rating of Speech Synthesis Corpora","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-06T20:57:18.991444Z"},"links":{"citing_paper":"/paper/2507.01356"},"observation_digest":"sha256:bc8f29beb1137b51a8065db234e818d1b99e65d70cebff06084fbe1928a56f7b","observation_id":"371892d8-936d-4ec5-b568-ac0bbe835ba2","resolution":{"observed_at":"2026-08-06T20:57:24.024783Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T20:57:23.844290Z","title":"Body height, immu- nity, facial and vocal attractiveness in young men,","venue":null,"work_id":"9699ab96-b982-4291-b155-b7cd7d6903db","year":2014},"citing_paper":{"arxiv_id":"2507.01356","last_updated":"2025-07-02T04:47:43Z","snapshot_observed_at":"2026-08-09T10:25:51.055237Z","submitted_at":"2025-07-02T04:47:43Z","title":"Voice Conversion for Likability Control via Automated Rating of Speech Synthesis Corpora","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-06T20:57:19.093846Z"},"links":{"citing_paper":"/paper/2507.01356"},"observation_digest":"sha256:ae83c7b74178b81c351396166784aa78e3e7c37b709f5a8190d456dcd49f853f","observation_id":"ab915ade-da1f-47bd-918f-ea45391ae90c","resolution":{"observed_at":"2026-08-06T20:57:23.882742Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T20:57:23.708757Z","title":"“Would you buy a car from me?","venue":null,"work_id":"f8dcf32b-3b45-457f-a680-745ed9df7702","year":2011},"citing_paper":{"arxiv_id":"2507.01356","last_updated":"2025-07-02T04:47:43Z","snapshot_observed_at":"2026-08-09T10:25:51.055237Z","submitted_at":"2025-07-02T04:47:43Z","title":"Voice Conversion for Likability Control via Automated Rating of Speech Synthesis Corpora","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-06T20:57:19.164253Z"},"links":{"citing_paper":"/paper/2507.01356"},"observation_digest":"sha256:20fb6f69977772ce04424756793ffe1da084c0992ebc2b6471ca5465c8f579cc","observation_id":"895134ed-728f-4305-b7fa-7f9c44e70c2d","resolution":{"observed_at":"2026-08-06T20:57:23.753317Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T20:57:23.554675Z","title":"Who finds this voice attractive? A large-scale experiment using in-the-wild data,","venue":null,"work_id":"efc5b222-fe3c-40d7-bb98-d8d75c922b13","year":2024},"citing_paper":{"arxiv_id":"2507.01356","last_updated":"2025-07-02T04:47:43Z","snapshot_observed_at":"2026-08-09T10:25:51.055237Z","submitted_at":"2025-07-02T04:47:43Z","title":"Voice Conversion for Likability Control via Automated Rating of Speech Synthesis Corpora","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-06T20:57:19.263539Z"},"links":{"citing_paper":"/paper/2507.01356"},"observation_digest":"sha256:0dd47d26b0cc618553223e80f6446e65b6cde8bf76f4a223f417e863478c1c62","observation_id":"3caa2f1f-8acf-40b8-ab23-3f368493bcb2","resolution":{"observed_at":"2026-08-06T20:57:23.651545Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T20:57:23.447359Z","title":"X-vectors: Robust DNN embeddings for speaker recogni- tion,","venue":null,"work_id":"c61aa054-a24d-4a88-a3bb-690996079a0f","year":2018},"citing_paper":{"arxiv_id":"2507.01356","last_updated":"2025-07-02T04:47:43Z","snapshot_observed_at":"2026-08-09T10:25:51.055237Z","submitted_at":"2025-07-02T04:47:43Z","title":"Voice Conversion for Likability Control via Automated Rating of Speech Synthesis Corpora","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-06T20:57:19.337644Z"},"links":{"citing_paper":"/paper/2507.01356"},"observation_digest":"sha256:7e02b2fe98b5b3c47f3eaa0a8c4822e9cb8e673c5d18f57d5db432b2e55f6f15","observation_id":"b536d1c4-fa4d-4c42-b5a6-a27b80cd9e5b","resolution":{"observed_at":"2026-08-06T20:57:23.504967Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T20:57:23.344182Z","title":"AutoMOS: Learning a non-intrusive as- sessor of naturalness-of-speech,","venue":null,"work_id":"ab1387cc-ab46-4aed-821d-7dd527205c5c","year":2016},"citing_paper":{"arxiv_id":"2507.01356","last_updated":"2025-07-02T04:47:43Z","snapshot_observed_at":"2026-08-09T10:25:51.055237Z","submitted_at":"2025-07-02T04:47:43Z","title":"Voice Conversion for Likability Control via Automated Rating of Speech Synthesis Corpora","version":1},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-06T20:57:19.428129Z"},"links":{"citing_paper":"/paper/2507.01356"},"observation_digest":"sha256:2c615b530fcb4ed7c031bde1e12ce486e365559ec5064ab2466cc6ba7f5c05b9","observation_id":"cadd9e0f-5719-430e-af2c-af9183318c13","resolution":{"observed_at":"2026-08-06T20:57:23.399692Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T20:57:23.194471Z","title":"UTMOS: UTokyo-SaruLab system for V oice- MOS Challenge 2022,","venue":null,"work_id":"a66695ff-2158-4460-b596-2defc5df5ac2","year":2022},"citing_paper":{"arxiv_id":"2507.01356","last_updated":"2025-07-02T04:47:43Z","snapshot_observed_at":"2026-08-09T10:25:51.055237Z","submitted_at":"2025-07-02T04:47:43Z","title":"Voice Conversion for Likability Control via Automated Rating of Speech Synthesis Corpora","version":1},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-06T20:57:19.511136Z"},"links":{"citing_paper":"/paper/2507.01356"},"observation_digest":"sha256:6ca87f21f2e7300179cf05d6da20b06c3d28acef9f4ef06a31993e927bc3cfe6","observation_id":"dbf7f51f-59eb-4a52-b737-02e9b19d3b5a","resolution":{"observed_at":"2026-08-06T20:57:23.233217Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T20:57:23.068996Z","title":"Predicting likability of speakers with Gaussian processes,","venue":null,"work_id":"c9f6a274-c066-4117-ac1c-077ad6aa9460","year":2012},"citing_paper":{"arxiv_id":"2507.01356","last_updated":"2025-07-02T04:47:43Z","snapshot_observed_at":"2026-08-09T10:25:51.055237Z","submitted_at":"2025-07-02T04:47:43Z","title":"Voice Conversion for Likability Control via Automated Rating of Speech Synthesis Corpora","version":1},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-06T20:57:19.582017Z"},"links":{"citing_paper":"/paper/2507.01356"},"observation_digest":"sha256:2eacad413d86a05845c067161a5d9812780b6fe4367ee524cfefd5fd0f1eaec1","observation_id":"c38a2d71-fce1-493d-97ea-5273920203b8","resolution":{"observed_at":"2026-08-06T20:57:23.128193Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T20:57:22.922183Z","title":"Likability of human voices: A feature analysis and a neural network regression approach to automatic likability estimation,","venue":null,"work_id":"aa303bd4-d1e2-4aa7-ae31-40a64c5dc9d2","year":2013},"citing_paper":{"arxiv_id":"2507.01356","last_updated":"2025-07-02T04:47:43Z","snapshot_observed_at":"2026-08-09T10:25:51.055237Z","submitted_at":"2025-07-02T04:47:43Z","title":"Voice Conversion for Likability Control via Automated Rating of Speech Synthesis Corpora","version":1},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-06T20:57:19.651417Z"},"links":{"citing_paper":"/paper/2507.01356"},"observation_digest":"sha256:26ac1a458eeee08e8b917274a87a476a77763fb65f96ccb64cfd493bb8d41cc0","observation_id":"efa17088-f0fa-42f5-b52c-471d4b9a6fa2","resolution":{"observed_at":"2026-08-06T20:57:22.994720Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T20:57:22.638350Z","title":"Any-to-one sequence- to-sequence voice conversion using self-supervised discrete speech representations,","venue":null,"work_id":"eaa07a28-2170-466c-b56b-db108b5dfd86","year":2021},"citing_paper":{"arxiv_id":"2507.01356","last_updated":"2025-07-02T04:47:43Z","snapshot_observed_at":"2026-08-09T10:25:51.055237Z","submitted_at":"2025-07-02T04:47:43Z","title":"Voice Conversion for Likability Control via Automated Rating of Speech Synthesis Corpora","version":1},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-06T20:57:19.738359Z"},"links":{"citing_paper":"/paper/2507.01356"},"observation_digest":"sha256:8cce930417f84b1f686fadda23fb4e86d27cea8aca4e5a7a53d4e0c6800c2da3","observation_id":"d8cd9a3e-629f-483c-b3a7-2ee785ab3d9e","resolution":{"observed_at":"2026-08-06T20:57:22.789358Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T20:57:22.438155Z","title":"A comparison of discrete and soft speech units for improved voice conversion,","venue":null,"work_id":"e7df7de0-0423-48f8-bfd9-b5e3d4a6b02b","year":2022},"citing_paper":{"arxiv_id":"2507.01356","last_updated":"2025-07-02T04:47:43Z","snapshot_observed_at":"2026-08-09T10:25:51.055237Z","submitted_at":"2025-07-02T04:47:43Z","title":"Voice Conversion for Likability Control via Automated Rating of Speech Synthesis Corpora","version":1},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-08-06T20:57:19.824864Z"},"links":{"citing_paper":"/paper/2507.01356"},"observation_digest":"sha256:7321e625df341179e844b5daa71199d19ca0f770f9e6773bd08708731eb58740","observation_id":"8c1bc13b-24ef-454c-9986-b29fe75547f4","resolution":{"observed_at":"2026-08-06T20:57:22.532948Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T20:57:22.211342Z","title":"ECAPA- TDNN: Emphasized channel attention, propagation and aggrega- tion in TDNN based speaker verification,","venue":null,"work_id":"2ce4faff-3f1a-4678-98fa-4c45475dda2c","year":2020},"citing_paper":{"arxiv_id":"2507.01356","last_updated":"2025-07-02T04:47:43Z","snapshot_observed_at":"2026-08-09T10:25:51.055237Z","submitted_at":"2025-07-02T04:47:43Z","title":"Voice Conversion for Likability Control via Automated Rating of Speech Synthesis Corpora","version":1},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-08-06T20:57:19.891403Z"},"links":{"citing_paper":"/paper/2507.01356"},"observation_digest":"sha256:827d9ae9b7c7d9b6807b53878b6b2b4f73ad1092cec42edef264cfddfca68ed0","observation_id":"19c710ef-add1-49fb-b0b3-0418e253373c","resolution":{"observed_at":"2026-08-06T20:57:22.341275Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T20:57:19.988186Z","title":"HuBERT: Self-supervised speech representation learning by masked prediction of hidden units,","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2507.01356","last_updated":"2025-07-02T04:47:43Z","snapshot_observed_at":"2026-08-09T10:25:51.055237Z","submitted_at":"2025-07-02T04:47:43Z","title":"Voice Conversion for Likability Control via Automated Rating of Speech Synthesis Corpora","version":1},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-08-06T20:57:19.988186Z"},"links":{"citing_paper":"/paper/2507.01356"},"observation_digest":"sha256:11a54b2d47a44f530a1f3ab2cb926a92dc846f8264f9dbe4575efc151dfe10e1","observation_id":"c77cc98f-eea7-4d33-b14b-323b874bea3b","resolution":{"observed_at":"2026-08-06T20:57:19.988186Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T20:57:22.027603Z","title":"FastSpeech 2: Fast and high-quality end-to-end text to speech,","venue":null,"work_id":"6ee25880-d6e7-402a-93b3-8acb87e8b2cf","year":2021},"citing_paper":{"arxiv_id":"2507.01356","last_updated":"2025-07-02T04:47:43Z","snapshot_observed_at":"2026-08-09T10:25:51.055237Z","submitted_at":"2025-07-02T04:47:43Z","title":"Voice Conversion for Likability Control via Automated Rating of Speech Synthesis Corpora","version":1},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-08-06T20:57:20.049507Z"},"links":{"citing_paper":"/paper/2507.01356"},"observation_digest":"sha256:65e140d192f9798aa87c9ca5097f72d51a398926355eb7797a2ab0f6a230da28","observation_id":"51e4aa7b-c884-4b60-b210-eaec51e24442","resolution":{"observed_at":"2026-08-06T20:57:22.135182Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T20:57:21.874423Z","title":"Coco-Nut: Corpus of Japanese utterance and voice characteristics description for prompt-based control,","venue":null,"work_id":"587ae9fe-e084-4e2a-ad59-a850aeb7740e","year":2023},"citing_paper":{"arxiv_id":"2507.01356","last_updated":"2025-07-02T04:47:43Z","snapshot_observed_at":"2026-08-09T10:25:51.055237Z","submitted_at":"2025-07-02T04:47:43Z","title":"Voice Conversion for Likability Control via Automated Rating of Speech Synthesis Corpora","version":1},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-08-06T20:57:20.144086Z"},"links":{"citing_paper":"/paper/2507.01356"},"observation_digest":"sha256:29ace16330b6024249ebe614470118c27bbaa2489e90ae61660223fa413fb4a2","observation_id":"3112be43-b293-4e13-b6d1-cb3623e3e7b3","resolution":{"observed_at":"2026-08-06T20:57:21.933572Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T20:57:21.741191Z","title":"Statistics of natural reverberation enable perceptual separation of sound and space,","venue":null,"work_id":"564a33e1-af16-468d-bc5b-0af8e5ef7cd7","year":2016},"citing_paper":{"arxiv_id":"2507.01356","last_updated":"2025-07-02T04:47:43Z","snapshot_observed_at":"2026-08-09T10:25:51.055237Z","submitted_at":"2025-07-02T04:47:43Z","title":"Voice Conversion for Likability Control via Automated Rating of Speech Synthesis Corpora","version":1},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-08-06T20:57:20.209537Z"},"links":{"citing_paper":"/paper/2507.01356"},"observation_digest":"sha256:7b70655cb73799f90584a4460226338febfd7276c1446a046d7e2ad487d9605c","observation_id":"4524625e-a868-4566-83b9-a8f04f9c76f9","resolution":{"observed_at":"2026-08-06T20:57:21.809696Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1908.06248","last_updated":"2019-08-17T06:04:46Z","snapshot_observed_at":"2026-08-10T04:14:03.409069Z","submitted_at":"2019-08-17T06:04:46Z","title":"JVS corpus: free Japanese multi-speaker voice corpus","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1908.06248","snapshot_observed_at":"2026-08-06T20:57:20.273534Z","title":"JVS corpus: free Japanese multi-speaker voice corpus,","venue":null,"work_id":null,"year":1908},"citing_paper":{"arxiv_id":"2507.01356","last_updated":"2025-07-02T04:47:43Z","snapshot_observed_at":"2026-08-09T10:25:51.055237Z","submitted_at":"2025-07-02T04:47:43Z","title":"Voice Conversion for Likability Control via Automated Rating of Speech Synthesis Corpora","version":1},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-08-06T20:57:20.273534Z"},"links":{"cited_paper":"/paper/1908.06248","citing_paper":"/paper/2507.01356"},"observation_digest":"sha256:8f0cf7e5291f3882e5fa788caeb6257a2368b62190a7e53a71210d3ae8d3c771","observation_id":"bd3339e8-1d63-4aab-bd2c-2d24801c95e4","resolution":{"observed_at":"2026-08-06T20:57:20.273534Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T20:57:21.559313Z","title":"Construction and anal- ysis of phonetically and prosodically balanced emotional speech database,","venue":null,"work_id":"63197efc-7416-4a53-93fa-bdcfc1d44121","year":2016},"citing_paper":{"arxiv_id":"2507.01356","last_updated":"2025-07-02T04:47:43Z","snapshot_observed_at":"2026-08-09T10:25:51.055237Z","submitted_at":"2025-07-02T04:47:43Z","title":"Voice Conversion for Likability Control via Automated Rating of Speech Synthesis Corpora","version":1},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-08-06T20:57:20.332263Z"},"links":{"citing_paper":"/paper/2507.01356"},"observation_digest":"sha256:18bbe12ea69a9d5bd1970242abe3bdda7eeace86bea044e109cf419a008c0a9e","observation_id":"55a02331-525b-406a-9ca5-e92406013222","resolution":{"observed_at":"2026-08-06T20:57:21.682444Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T20:57:21.377385Z","title":"Web-scale k-means clustering,","venue":null,"work_id":"65684fe0-4d52-4eec-b4e9-ebf82fe8d72f","year":2010},"citing_paper":{"arxiv_id":"2507.01356","last_updated":"2025-07-02T04:47:43Z","snapshot_observed_at":"2026-08-09T10:25:51.055237Z","submitted_at":"2025-07-02T04:47:43Z","title":"Voice Conversion for Likability Control via Automated Rating of Speech Synthesis Corpora","version":1},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-08-06T20:57:20.402259Z"},"links":{"citing_paper":"/paper/2507.01356"},"observation_digest":"sha256:3137aeedb53dfc93998fd3fb1b998cbc5572b1c4d176e4f7764f410718268745","observation_id":"b480e542-2712-46ef-891f-a217c8c78c1a","resolution":{"observed_at":"2026-08-06T20:57:21.464540Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T20:57:21.196977Z","title":"Auto- matic speech recognition of Japanese dialects using large-scale self-supervised learning models (in Japanese),","venue":null,"work_id":"604029be-6f54-488a-ac08-18a715f3d6d2","year":2025},"citing_paper":{"arxiv_id":"2507.01356","last_updated":"2025-07-02T04:47:43Z","snapshot_observed_at":"2026-08-09T10:25:51.055237Z","submitted_at":"2025-07-02T04:47:43Z","title":"Voice Conversion for Likability Control via Automated Rating of Speech Synthesis Corpora","version":1},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-08-06T20:57:20.454996Z"},"links":{"citing_paper":"/paper/2507.01356"},"observation_digest":"sha256:17224e531b06e6c85904c45af3997655887f5441fcd7ff3ba0c44bfc3581567b","observation_id":"040f0ef3-ec99-4479-a30e-a3efec3c5054","resolution":{"observed_at":"2026-08-06T20:57:21.314980Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2106.04624","last_updated":"2021-06-08T18:22:56Z","snapshot_observed_at":"2026-08-04T07:20:14.379561Z","submitted_at":"2021-06-08T18:22:56Z","title":"SpeechBrain: A General-Purpose Speech Toolkit","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2106.04624","snapshot_observed_at":"2026-08-06T20:57:20.516101Z","title":"SpeechBrain: A general-purpose speech toolkit,","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2507.01356","last_updated":"2025-07-02T04:47:43Z","snapshot_observed_at":"2026-08-09T10:25:51.055237Z","submitted_at":"2025-07-02T04:47:43Z","title":"Voice Conversion for Likability Control via Automated Rating of Speech Synthesis Corpora","version":1},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-08-06T20:57:20.516101Z"},"links":{"cited_paper":"/paper/2106.04624","citing_paper":"/paper/2507.01356"},"observation_digest":"sha256:d4b4eccda3b1568c585ba94cc3566ba1522432df7d00ee02cc58f10afb7a47c7","observation_id":"bb351bdd-dbf9-495d-9809-0e3a5153c539","resolution":{"observed_at":"2026-08-06T20:57:20.516101Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T20:57:21.044874Z","title":"Conformer: Convolution-augmented transformer for speech recognition,","venue":null,"work_id":"c09e3946-e7d1-4888-9403-5c4dcd268ba6","year":2020},"citing_paper":{"arxiv_id":"2507.01356","last_updated":"2025-07-02T04:47:43Z","snapshot_observed_at":"2026-08-09T10:25:51.055237Z","submitted_at":"2025-07-02T04:47:43Z","title":"Voice Conversion for Likability Control via Automated Rating of Speech Synthesis Corpora","version":1},"reference_index":36,"source":"pdf_text","source_observed_at":"2026-08-06T20:57:20.597178Z"},"links":{"citing_paper":"/paper/2507.01356"},"observation_digest":"sha256:1cc9f9e98c4df40a1089f841904b782aba38f9079c1b9479254d4864c33113f8","observation_id":"0ff7bebe-0a79-48ac-b28f-2f1f775557ed","resolution":{"observed_at":"2026-08-06T20:57:21.131214Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T20:57:20.914259Z","title":"Construction of a large-scale Japanese ASR corpus on TV recordings,","venue":null,"work_id":"bb55b7bf-c3c4-4e20-a1b3-7dc039eac254","year":2021},"citing_paper":{"arxiv_id":"2507.01356","last_updated":"2025-07-02T04:47:43Z","snapshot_observed_at":"2026-08-09T10:25:51.055237Z","submitted_at":"2025-07-02T04:47:43Z","title":"Voice Conversion for Likability Control via Automated Rating of Speech Synthesis Corpora","version":1},"reference_index":37,"source":"pdf_text","source_observed_at":"2026-08-06T20:57:20.669235Z"},"links":{"citing_paper":"/paper/2507.01356"},"observation_digest":"sha256:b4a7631f30db76586f9121172d77295383115f106785cd271e1e2d75ad17836e","observation_id":"f4827899-549e-4dd9-a50b-614290314c98","resolution":{"observed_at":"2026-08-06T20:57:20.980350Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}}],"paper":{"arxiv_id":"2507.01356","last_updated":"2025-07-02T04:47:43Z","latest_version":1,"primary_category":"eess.AS","snapshot_observed_at":"2026-08-09T10:25:51.055237Z","submitted_at":"2025-07-02T04:47:43Z","title":"Voice Conversion for Likability Control via Automated Rating of Speech Synthesis Corpora"},"reference_resolution":{"displayed":37,"state_counts":{"malformed_identifier":0,"metadata_mismatch":1,"parse_uncertain":0,"unresolved":5,"verified_exact":0,"verified_fuzzy":31},"total_outbound_references":37},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"thesis":"As of 10 August 2026, this Paper Citation Record lists 37 of 37 outbound references and 1 inbound Pith citation observation for arXiv:2507.01356."}