{"as_of":"2026-08-09T22:10:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:8b89bf3831892dce4dd36144cf877e602a3b5aa8a36eb1b22159e5da8b296a03","coverage":[{"denominator":35,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":35,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-06T20:01:35.504834Z","state":"measured"},{"denominator":36,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":36,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-09T06:31:02.800959+00:00","state":"measured"},{"denominator":1,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":1,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-06T20:01:35.389936Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"pith","source_observed_at":"2026-08-06T20:01:35.649189Z","state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2507.08012","last_updated":"2025-07-05T10:59:00Z","snapshot_observed_at":"2026-08-08T05:05:40.148191Z","submitted_at":"2025-07-05T10:59:00Z","title":"RepeaTTS: Towards Feature Discovery through Repeated Fine-Tuning","version":1},"cited_work":{"arxiv_id":"2507.08012","doi":null,"metadata_source":"pith","pith_arxiv_id":"2507.08012","snapshot_observed_at":"2026-08-06T20:01:35.649189Z","title":"RepeaTTS: Towards Feature Discovery through Repeated Fine-Tuning","venue":"cs.CL","work_id":"47a4d182-3aae-442b-b1fe-32de9dcc5cf6","year":2025},"citing_paper":{"arxiv_id":"2507.08012","last_updated":"2025-07-05T10:59:00Z","snapshot_observed_at":"2026-08-08T05:05:40.148191Z","submitted_at":"2025-07-05T10:59:00Z","title":"RepeaTTS: Towards Feature Discovery through Repeated Fine-Tuning","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-06T20:01:35.389936Z"},"links":{"cited_paper":"/paper/2507.08012","citing_paper":"/paper/2507.08012"},"observation_digest":"sha256:8815a5794d292909a46bd910ed80450405620964484a52cca2ec2d7a3515a219","observation_id":"88c4474d-38bd-4648-9b9d-8edf46eaec14","resolution":{"observed_at":"2026-08-06T20:01:35.653217Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}}],"links":{"evidence":"/evidence","html":"/paper/2507.08012/citation-record","integrity":"/paper/2507.08012/integrity","json":"/paper/2507.08012/citation-record.json","paper":"/paper/2507.08012"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T20:01:35.919508Z","title":"Given text, TTS models pre- dict a probable speech rendition under the statistics of the train- ing data","venue":null,"work_id":"819839b6-433e-4d3f-a64a-855add81925f","year":null},"citing_paper":{"arxiv_id":"2507.08012","last_updated":"2025-07-05T10:59:00Z","snapshot_observed_at":"2026-08-08T05:05:40.148191Z","submitted_at":"2025-07-05T10:59:00Z","title":"RepeaTTS: Towards Feature Discovery through Repeated Fine-Tuning","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-06T20:01:35.385645Z"},"links":{"citing_paper":"/paper/2507.08012"},"observation_digest":"sha256:6eef6a8fff74f3b92d858885e741fc5fb7124684ba69605b794096efd8fb6e34","observation_id":"3af133f6-c2b7-49c2-88d6-ff2680602b7b","resolution":{"observed_at":"2026-08-06T20:01:35.922910Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2507.08012","last_updated":"2025-07-05T10:59:00Z","snapshot_observed_at":"2026-08-08T05:05:40.148191Z","submitted_at":"2025-07-05T10:59:00Z","title":"RepeaTTS: Towards Feature Discovery through Repeated Fine-Tuning","version":1},"cited_work":{"arxiv_id":"2507.08012","doi":null,"metadata_source":"pith","pith_arxiv_id":"2507.08012","snapshot_observed_at":"2026-08-06T20:01:35.649189Z","title":"RepeaTTS: Towards Feature Discovery through Repeated Fine-Tuning","venue":"cs.CL","work_id":"47a4d182-3aae-442b-b1fe-32de9dcc5cf6","year":2025},"citing_paper":{"arxiv_id":"2507.08012","last_updated":"2025-07-05T10:59:00Z","snapshot_observed_at":"2026-08-08T05:05:40.148191Z","submitted_at":"2025-07-05T10:59:00Z","title":"RepeaTTS: Towards Feature Discovery through Repeated Fine-Tuning","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-06T20:01:35.389936Z"},"links":{"cited_paper":"/paper/2507.08012","citing_paper":"/paper/2507.08012"},"observation_digest":"sha256:8815a5794d292909a46bd910ed80450405620964484a52cca2ec2d7a3515a219","observation_id":"88c4474d-38bd-4648-9b9d-8edf46eaec14","resolution":{"observed_at":"2026-08-06T20:01:35.653217Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T20:01:35.908682Z","title":"Sections 3.1-3.2 discuss which TTS architecture, training data, and utterance representations we use to support the model analysis","venue":null,"work_id":"c15bd663-423f-40b8-a7db-3cab2fe49704","year":null},"citing_paper":{"arxiv_id":"2507.08012","last_updated":"2025-07-05T10:59:00Z","snapshot_observed_at":"2026-08-08T05:05:40.148191Z","submitted_at":"2025-07-05T10:59:00Z","title":"RepeaTTS: Towards Feature Discovery through Repeated Fine-Tuning","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-06T20:01:35.394620Z"},"links":{"citing_paper":"/paper/2507.08012"},"observation_digest":"sha256:eb1e1a2672f56e944884597cabda7ea47f0638c3834627782d3b6599b8d7d857","observation_id":"8c2cff13-0060-4fcc-8a7c-60fc6acf4401","resolution":{"observed_at":"2026-08-06T20:01:35.912375Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T20:01:35.887113Z","title":null,"venue":null,"work_id":"7792fc0a-aaf4-4635-9b28-5e0ad0f80243","year":null},"citing_paper":{"arxiv_id":"2507.08012","last_updated":"2025-07-05T10:59:00Z","snapshot_observed_at":"2026-08-08T05:05:40.148191Z","submitted_at":"2025-07-05T10:59:00Z","title":"RepeaTTS: Towards Feature Discovery through Repeated Fine-Tuning","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-06T20:01:35.402284Z"},"links":{"citing_paper":"/paper/2507.08012"},"observation_digest":"sha256:43bec62f5ee1887dc0d2328b87ffe7bd38f8684b2129314fb794af5b3897d70b","observation_id":"4ce67f57-cfef-405c-bedf-c68ac945336f","resolution":{"observed_at":"2026-08-06T20:01:35.890387Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T20:01:35.866081Z","title":null,"venue":null,"work_id":"767e5025-d92b-4512-80f4-2e052c8fe6d0","year":null},"citing_paper":{"arxiv_id":"2507.08012","last_updated":"2025-07-05T10:59:00Z","snapshot_observed_at":"2026-08-08T05:05:40.148191Z","submitted_at":"2025-07-05T10:59:00Z","title":"RepeaTTS: Towards Feature Discovery through Repeated Fine-Tuning","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-06T20:01:35.409780Z"},"links":{"citing_paper":"/paper/2507.08012"},"observation_digest":"sha256:17474992c530c91799c60750f59cb6655fe3a56bb24fc9f8e13362b7cf4a00e5","observation_id":"7b679e89-c1a3-4ef3-a7ca-e8cb0841a153","resolution":{"observed_at":"2026-08-06T20:01:35.869302Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T20:01:35.876392Z","title":"We then re-label the In- grid subset again according to cosine distance to cluster means","venue":null,"work_id":"debf25ff-c653-4faf-8680-10e0d953692b","year":null},"citing_paper":{"arxiv_id":"2507.08012","last_updated":"2025-07-05T10:59:00Z","snapshot_observed_at":"2026-08-08T05:05:40.148191Z","submitted_at":"2025-07-05T10:59:00Z","title":"RepeaTTS: Towards Feature Discovery through Repeated Fine-Tuning","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-06T20:01:35.405881Z"},"links":{"citing_paper":"/paper/2507.08012"},"observation_digest":"sha256:6f75066b4f9af00cccc6614b2f11818f23303afa0120e84a6eb80068837c27e9","observation_id":"a4333fd1-0af5-4cf4-91dc-988573f30063","resolution":{"observed_at":"2026-08-06T20:01:35.880082Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2105.01891","last_updated":"2021-05-05T06:49:21Z","snapshot_observed_at":"2026-08-08T05:06:05.744825Z","submitted_at":"2021-05-05T06:49:21Z","title":"Exploring emotional prototypes in a high dimensional TTS latent space","version":1},"cited_work":{"arxiv_id":"2105.01891","doi":null,"metadata_source":"pith","pith_arxiv_id":"2105.01891","snapshot_observed_at":"2026-08-06T20:01:35.601725Z","title":"Exploring emotional prototypes in a high dimensional TTS latent space","venue":"cs.HC","work_id":"febb0749-f018-45ae-81bc-73f2d6bfe4e4","year":2021},"citing_paper":{"arxiv_id":"2507.08012","last_updated":"2025-07-05T10:59:00Z","snapshot_observed_at":"2026-08-08T05:05:40.148191Z","submitted_at":"2025-07-05T10:59:00Z","title":"RepeaTTS: Towards Feature Discovery through Repeated Fine-Tuning","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-06T20:01:35.438717Z"},"links":{"cited_paper":"/paper/2105.01891","citing_paper":"/paper/2507.08012"},"observation_digest":"sha256:892f4110a1c8f9cc4cba5b72dd984c70013c200697cb59d58cc7e84d260161f7","observation_id":"6b6c151b-76ca-4492-be8a-f26e45229c8d","resolution":{"observed_at":"2026-08-06T20:01:35.607446Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T20:01:35.855243Z","title":null,"venue":null,"work_id":"a384e2e9-308d-441d-8989-496b3e5c6f08","year":null},"citing_paper":{"arxiv_id":"2507.08012","last_updated":"2025-07-05T10:59:00Z","snapshot_observed_at":"2026-08-08T05:05:40.148191Z","submitted_at":"2025-07-05T10:59:00Z","title":"RepeaTTS: Towards Feature Discovery through Repeated Fine-Tuning","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-06T20:01:35.413785Z"},"links":{"citing_paper":"/paper/2507.08012"},"observation_digest":"sha256:bd581a12007a96b4322662b862a23444356cc83ffe3b5ebe28287444dd625b5c","observation_id":"c94b6108-59d4-4e77-935d-610ada287b22","resolution":{"observed_at":"2026-08-06T20:01:35.858954Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T20:01:35.843581Z","title":"To- wards end-to-end prosody transfer for expressive speech synthesis with tacotron,","venue":null,"work_id":"51cef31e-17b5-44d3-b995-36e7639482b1","year":2018},"citing_paper":{"arxiv_id":"2507.08012","last_updated":"2025-07-05T10:59:00Z","snapshot_observed_at":"2026-08-08T05:05:40.148191Z","submitted_at":"2025-07-05T10:59:00Z","title":"RepeaTTS: Towards Feature Discovery through Repeated Fine-Tuning","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-06T20:01:35.417178Z"},"links":{"citing_paper":"/paper/2507.08012"},"observation_digest":"sha256:10d3d3366f88c1f643c35521012db3bd896b1238f4a53bd8d91b4269f26f4288","observation_id":"94a2c64b-5d1f-4484-a148-3304c3639bd9","resolution":{"observed_at":"2026-08-06T20:01:35.847501Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2006.04558","last_updated":"2022-08-08T01:53:05Z","snapshot_observed_at":"2026-08-06T18:05:37.673476Z","submitted_at":"2020-06-08T13:05:40Z","title":"FastSpeech 2: Fast and High-Quality End-to-End Text to Speech","version":8},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2006.04558","snapshot_observed_at":"2026-08-06T20:01:35.420849Z","title":"Fastspeech 2: Fast and high-quality end-to-end text to speech,","venue":null,"work_id":null,"year":2006},"citing_paper":{"arxiv_id":"2507.08012","last_updated":"2025-07-05T10:59:00Z","snapshot_observed_at":"2026-08-08T05:05:40.148191Z","submitted_at":"2025-07-05T10:59:00Z","title":"RepeaTTS: Towards Feature Discovery through Repeated Fine-Tuning","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-06T20:01:35.420849Z"},"links":{"cited_paper":"/paper/2006.04558","citing_paper":"/paper/2507.08012"},"observation_digest":"sha256:76d21d6573eb0af9ea4c63aec568b1d44a796554614cf82fb3c6455712ba4fd2","observation_id":"5402b3f9-b82d-4aa5-aab3-8a802652788f","resolution":{"observed_at":"2026-08-06T20:01:35.420849Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T20:01:35.832579Z","title":"Natural language guidance of high-fidelity text-to-speech with synthetic annotations,","venue":null,"work_id":"60394260-58b3-4745-aedb-f82fdfd2f91d","year":2024},"citing_paper":{"arxiv_id":"2507.08012","last_updated":"2025-07-05T10:59:00Z","snapshot_observed_at":"2026-08-08T05:05:40.148191Z","submitted_at":"2025-07-05T10:59:00Z","title":"RepeaTTS: Towards Feature Discovery through Repeated Fine-Tuning","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-06T20:01:35.424834Z"},"links":{"citing_paper":"/paper/2507.08012"},"observation_digest":"sha256:a1ef5c8ef78e051c5ef3999eebf8686e21b0207da9d46a7d1f41ad6d5f97cdac","observation_id":"53dbecd0-8f35-48b7-aaca-31c666ea434c","resolution":{"observed_at":"2026-08-06T20:01:35.836321Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T20:01:35.897613Z","title":"The names of those speakers can be included in the description prompt to re- call the chosen speaker identity","venue":null,"work_id":"47f76125-c485-41ca-8e97-9479ba679767","year":null},"citing_paper":{"arxiv_id":"2507.08012","last_updated":"2025-07-05T10:59:00Z","snapshot_observed_at":"2026-08-08T05:05:40.148191Z","submitted_at":"2025-07-05T10:59:00Z","title":"RepeaTTS: Towards Feature Discovery through Repeated Fine-Tuning","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-06T20:01:35.398527Z"},"links":{"citing_paper":"/paper/2507.08012"},"observation_digest":"sha256:c4056d35d82887806af6aa4550886e4d352ab9111b7d0e381b457a658add834f","observation_id":"b5b1c51d-808c-472d-99d0-ca7d6bba8d5b","resolution":{"observed_at":"2026-08-06T20:01:35.901498Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T20:01:35.821620Z","title":"Fastspeech: Fast, robust and controllable text to speech,","venue":null,"work_id":"6562e14e-af47-48e0-a937-9b9db834d9d7","year":2019},"citing_paper":{"arxiv_id":"2507.08012","last_updated":"2025-07-05T10:59:00Z","snapshot_observed_at":"2026-08-08T05:05:40.148191Z","submitted_at":"2025-07-05T10:59:00Z","title":"RepeaTTS: Towards Feature Discovery through Repeated Fine-Tuning","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-06T20:01:35.428467Z"},"links":{"citing_paper":"/paper/2507.08012"},"observation_digest":"sha256:c952bf7649e6f4ef444c08d952b8724547d135b0663d6889ad3a96dbac362bdc","observation_id":"81d55187-f1d4-4972-b8dc-11b4a421fe3d","resolution":{"observed_at":"2026-08-06T20:01:35.825223Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T20:01:35.810355Z","title":"A human-in-the-loop approach to improving cross-text prosody transfer","venue":null,"work_id":"caffbbb8-2758-4e32-8cd6-c200202bf592","year":null},"citing_paper":{"arxiv_id":"2507.08012","last_updated":"2025-07-05T10:59:00Z","snapshot_observed_at":"2026-08-08T05:05:40.148191Z","submitted_at":"2025-07-05T10:59:00Z","title":"RepeaTTS: Towards Feature Discovery through Repeated Fine-Tuning","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-06T20:01:35.431839Z"},"links":{"citing_paper":"/paper/2507.08012"},"observation_digest":"sha256:18836327ab96fa94c08710212052e4979d8dadfdf98756df3e47984323b20555","observation_id":"32b9379a-ab4c-4288-b43e-caec53e2fa2b","resolution":{"observed_at":"2026-08-06T20:01:35.814153Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2012.03763","last_updated":"2020-12-07T15:00:18Z","snapshot_observed_at":"2026-07-06T10:21:26.704390Z","submitted_at":"2020-12-07T15:00:18Z","title":"Using previous acoustic context to improve Text-to-Speech synthesis","version":1},"cited_work":{"arxiv_id":"2012.03763","doi":null,"metadata_source":"pith","pith_arxiv_id":"2012.03763","snapshot_observed_at":"2026-08-06T20:01:35.621053Z","title":"Using previous acoustic context to improve Text-to-Speech synthesis","venue":"cs.CL","work_id":"1aaf7314-4399-4877-b537-10e696d6733b","year":2020},"citing_paper":{"arxiv_id":"2507.08012","last_updated":"2025-07-05T10:59:00Z","snapshot_observed_at":"2026-08-08T05:05:40.148191Z","submitted_at":"2025-07-05T10:59:00Z","title":"RepeaTTS: Towards Feature Discovery through Repeated Fine-Tuning","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-06T20:01:35.434910Z"},"links":{"cited_paper":"/paper/2012.03763","citing_paper":"/paper/2507.08012"},"observation_digest":"sha256:5106cefc08a5372214867adda577b4b80bad153ce7491bd71e5ea16f1a7479e5","observation_id":"4836fd05-10a0-489e-9c39-9a063f0d5875","resolution":{"observed_at":"2026-08-06T20:01:35.624745Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T20:01:35.798234Z","title":"Style tokens: Unsu- pervised style modeling, control and transfer in end-to-end speech synthesis,","venue":null,"work_id":"1ae0d19f-4d4f-4e3d-9423-ca2548440070","year":2018},"citing_paper":{"arxiv_id":"2507.08012","last_updated":"2025-07-05T10:59:00Z","snapshot_observed_at":"2026-08-08T05:05:40.148191Z","submitted_at":"2025-07-05T10:59:00Z","title":"RepeaTTS: Towards Feature Discovery through Repeated Fine-Tuning","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-06T20:01:35.442477Z"},"links":{"citing_paper":"/paper/2507.08012"},"observation_digest":"sha256:16d6ea1b849627c6ca8a7d00a7dacf1bae9d85d26c42fcbf4e217033c4e13399","observation_id":"38a9bf71-3675-4145-a0a5-660d27eea3fc","resolution":{"observed_at":"2026-08-06T20:01:35.802289Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T20:01:35.786302Z","title":"Mellotron: Mul- tispeaker expressive voice synthesis by conditioning on rhythm, pitch and global style tokens,","venue":null,"work_id":"2da29ed3-a87c-4df1-bdb9-e907c5ca639c","year":2020},"citing_paper":{"arxiv_id":"2507.08012","last_updated":"2025-07-05T10:59:00Z","snapshot_observed_at":"2026-08-08T05:05:40.148191Z","submitted_at":"2025-07-05T10:59:00Z","title":"RepeaTTS: Towards Feature Discovery through Repeated Fine-Tuning","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-06T20:01:35.445544Z"},"links":{"citing_paper":"/paper/2507.08012"},"observation_digest":"sha256:2891ab919b1957a94e0d83c569538dcdebfc70474db7bd0ac951dccb91566245","observation_id":"5881b86a-39c2-4174-9295-5d9c8c67e6e0","resolution":{"observed_at":"2026-08-06T20:01:35.789823Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T20:01:35.775153Z","title":"Do prosody transfer mod- els transfer prosodyƒ,","venue":null,"work_id":"6c935555-6895-4cdb-af52-fb68696cc2f1","year":2023},"citing_paper":{"arxiv_id":"2507.08012","last_updated":"2025-07-05T10:59:00Z","snapshot_observed_at":"2026-08-08T05:05:40.148191Z","submitted_at":"2025-07-05T10:59:00Z","title":"RepeaTTS: Towards Feature Discovery through Repeated Fine-Tuning","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-06T20:01:35.448724Z"},"links":{"citing_paper":"/paper/2507.08012"},"observation_digest":"sha256:b29d9927245efd4264068ff55810f9e8bdd6be37997e624516e1af940481fc64","observation_id":"af250d61-e805-4e9d-a027-29310a0ffeed","resolution":{"observed_at":"2026-08-06T20:01:35.778544Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T20:01:35.764028Z","title":"Hierarchical generative modeling for controllable speech synthesis,","venue":null,"work_id":"76675e50-d9fa-4642-88f7-b33ee6fb7627","year":2019},"citing_paper":{"arxiv_id":"2507.08012","last_updated":"2025-07-05T10:59:00Z","snapshot_observed_at":"2026-08-08T05:05:40.148191Z","submitted_at":"2025-07-05T10:59:00Z","title":"RepeaTTS: Towards Feature Discovery through Repeated Fine-Tuning","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-06T20:01:35.451835Z"},"links":{"citing_paper":"/paper/2507.08012"},"observation_digest":"sha256:d4feaf1d5c94c8940356b2db9a32c6f96bbd36ec1a3688d855e896e0d2d76af7","observation_id":"21c6f1fd-89fb-43aa-b334-4d550e51d20b","resolution":{"observed_at":"2026-08-06T20:01:35.767567Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T20:01:35.752400Z","title":"Parler-tts,","venue":null,"work_id":"03cc8647-15d4-4293-8562-a4633a6a04bc","year":2024},"citing_paper":{"arxiv_id":"2507.08012","last_updated":"2025-07-05T10:59:00Z","snapshot_observed_at":"2026-08-08T05:05:40.148191Z","submitted_at":"2025-07-05T10:59:00Z","title":"RepeaTTS: Towards Feature Discovery through Repeated Fine-Tuning","version":1},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-06T20:01:35.455236Z"},"links":{"citing_paper":"/paper/2507.08012"},"observation_digest":"sha256:cf9f18e8454c6fe6424651334054b00ffee6c09f77ac82a52fe9a042c374bfdf","observation_id":"3b672c54-248b-4607-8b09-9ab67851b490","resolution":{"observed_at":"2026-08-06T20:01:35.756076Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2211.12171","last_updated":"2022-11-22T10:58:38Z","snapshot_observed_at":"2026-08-09T10:04:02.290089Z","submitted_at":"2022-11-22T10:58:38Z","title":"PromptTTS: Controllable Text-to-Speech with Text Descriptions","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2211.12171","snapshot_observed_at":"2026-08-06T20:01:35.458407Z","title":"Prompttts: Con- trollable text-to-speech with text descriptions,","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2507.08012","last_updated":"2025-07-05T10:59:00Z","snapshot_observed_at":"2026-08-08T05:05:40.148191Z","submitted_at":"2025-07-05T10:59:00Z","title":"RepeaTTS: Towards Feature Discovery through Repeated Fine-Tuning","version":1},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-06T20:01:35.458407Z"},"links":{"cited_paper":"/paper/2211.12171","citing_paper":"/paper/2507.08012"},"observation_digest":"sha256:0c09fc1fe45427db4e6946453e3c0ebb1db86e1ae7996d5b9fab45046b8fb749","observation_id":"8940ffb5-6e18-4948-ab54-0e82cd0d3441","resolution":{"observed_at":"2026-08-06T20:01:35.458407Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T20:01:35.741336Z","title":"Instructtts: Modelling expressive tts in discrete latent space with natural language style prompt,","venue":null,"work_id":"9b0c0492-c759-4e21-8701-9b13c44d5928","year":2023},"citing_paper":{"arxiv_id":"2507.08012","last_updated":"2025-07-05T10:59:00Z","snapshot_observed_at":"2026-08-08T05:05:40.148191Z","submitted_at":"2025-07-05T10:59:00Z","title":"RepeaTTS: Towards Feature Discovery through Repeated Fine-Tuning","version":1},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-06T20:01:35.462256Z"},"links":{"citing_paper":"/paper/2507.08012"},"observation_digest":"sha256:2f98c2c9f8c3b1086763047a220e592a4625c2bb18c1b7a081a6a7a82238c1f9","observation_id":"6049c4f3-8645-4b9b-a292-e5a10095a3af","resolution":{"observed_at":"2026-08-06T20:01:35.744754Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2210.11416","last_updated":"2022-12-06T21:39:48Z","snapshot_observed_at":"2026-07-06T14:08:18.855958Z","submitted_at":"2022-10-20T16:58:32Z","title":"Scaling Instruction-Finetuned Language Models","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2210.11416","snapshot_observed_at":"2026-08-06T20:01:35.466074Z","title":"Scaling instruction-finetuned language models,","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2507.08012","last_updated":"2025-07-05T10:59:00Z","snapshot_observed_at":"2026-08-08T05:05:40.148191Z","submitted_at":"2025-07-05T10:59:00Z","title":"RepeaTTS: Towards Feature Discovery through Repeated Fine-Tuning","version":1},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-06T20:01:35.466074Z"},"links":{"cited_paper":"/paper/2210.11416","citing_paper":"/paper/2507.08012"},"observation_digest":"sha256:98e9681e6e947660982b19d7ec0d1941d3f993c3a47d9c214c7485f18a628451","observation_id":"0fe659c6-439d-4a85-a97e-2bb1e78f73e5","resolution":{"observed_at":"2026-08-06T20:01:35.466074Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T20:01:35.469532Z","title":"Perceptual evaluation of speech quality (pesq)-a new method for speech quality assessment of telephone networks and codecs,","venue":null,"work_id":null,"year":2001},"citing_paper":{"arxiv_id":"2507.08012","last_updated":"2025-07-05T10:59:00Z","snapshot_observed_at":"2026-08-08T05:05:40.148191Z","submitted_at":"2025-07-05T10:59:00Z","title":"RepeaTTS: Towards Feature Discovery through Repeated Fine-Tuning","version":1},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-06T20:01:35.469532Z"},"links":{"citing_paper":"/paper/2507.08012"},"observation_digest":"sha256:fb8cf3bdecfd9dfb259e1cc2d87f2f036e2e5d00865409cb053e5866769381ca","observation_id":"ff6854c7-b7d9-473c-959f-b57bcc9c8540","resolution":{"observed_at":"2026-08-06T20:01:35.469532Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T20:01:35.722904Z","title":"Sdr– half-baked or well done?","venue":null,"work_id":"07278c50-61e3-4481-abf0-6ff8518c0111","year":2019},"citing_paper":{"arxiv_id":"2507.08012","last_updated":"2025-07-05T10:59:00Z","snapshot_observed_at":"2026-08-08T05:05:40.148191Z","submitted_at":"2025-07-05T10:59:00Z","title":"RepeaTTS: Towards Feature Discovery through Repeated Fine-Tuning","version":1},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-08-06T20:01:35.472740Z"},"links":{"citing_paper":"/paper/2507.08012"},"observation_digest":"sha256:6a2e8d4ce65ce4b170d4bd9ee8a25335dc90b2f7c97c5f1ece07229fd6bebdf6","observation_id":"0723b4ff-b7a1-4604-9a77-4abf1df5977d","resolution":{"observed_at":"2026-08-06T20:01:35.726107Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2301.12258","last_updated":"2024-08-12T03:23:09Z","snapshot_observed_at":"2026-08-01T14:42:12.372500Z","submitted_at":"2023-01-28T17:30:47Z","title":"Cross-domain Neural Pitch and Periodicity Estimation","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2301.12258","snapshot_observed_at":"2026-08-06T20:01:35.475879Z","title":"Cross- domain neural pitch and periodicity estimation,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2507.08012","last_updated":"2025-07-05T10:59:00Z","snapshot_observed_at":"2026-08-08T05:05:40.148191Z","submitted_at":"2025-07-05T10:59:00Z","title":"RepeaTTS: Towards Feature Discovery through Repeated Fine-Tuning","version":1},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-08-06T20:01:35.475879Z"},"links":{"cited_paper":"/paper/2301.12258","citing_paper":"/paper/2507.08012"},"observation_digest":"sha256:75042f3048810b17ece54c478fa8052ed146750af01d49ca661e507d6589ced1","observation_id":"232cef0d-96f3-4f68-898d-57ac5e12df3e","resolution":{"observed_at":"2026-08-06T20:01:35.475879Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T20:01:35.711761Z","title":"Talrómur 3 v0.1 (24.09),","venue":null,"work_id":"d2687304-9223-4b13-897f-9b7f7a42a954","year":2024},"citing_paper":{"arxiv_id":"2507.08012","last_updated":"2025-07-05T10:59:00Z","snapshot_observed_at":"2026-08-08T05:05:40.148191Z","submitted_at":"2025-07-05T10:59:00Z","title":"RepeaTTS: Towards Feature Discovery through Repeated Fine-Tuning","version":1},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-08-06T20:01:35.479099Z"},"links":{"citing_paper":"/paper/2507.08012"},"observation_digest":"sha256:6b0f8caf64d5d6b6adddc7d4b49bc3aa421c06fa3d79d624cacb0bbb35597a20","observation_id":"4bfe7e00-20f0-4098-a0aa-6190f1ced734","resolution":{"observed_at":"2026-08-06T20:01:35.715102Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2302.13971","last_updated":"2023-02-27T17:11:15Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2023-02-27T17:11:15Z","title":"LLaMA: Open and Efficient Foundation Language Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2302.13971","snapshot_observed_at":"2026-08-06T20:01:35.482339Z","title":"Llama: Open and efficient foundation language models,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2507.08012","last_updated":"2025-07-05T10:59:00Z","snapshot_observed_at":"2026-08-08T05:05:40.148191Z","submitted_at":"2025-07-05T10:59:00Z","title":"RepeaTTS: Towards Feature Discovery through Repeated Fine-Tuning","version":1},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-08-06T20:01:35.482339Z"},"links":{"cited_paper":"/paper/2302.13971","citing_paper":"/paper/2507.08012"},"observation_digest":"sha256:02ab5391edd3b2a55b50c9adaeaabee1b5b1cd4783e649e4240e7631b5ae59c5","observation_id":"7f8ff515-d74d-4ad5-bdde-81ad26873848","resolution":{"observed_at":"2026-08-06T20:01:35.482339Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T20:01:35.700024Z","title":"Mistral 7b,","venue":null,"work_id":"203d1735-c98c-43b8-ae85-521d32a35562","year":null},"citing_paper":{"arxiv_id":"2507.08012","last_updated":"2025-07-05T10:59:00Z","snapshot_observed_at":"2026-08-08T05:05:40.148191Z","submitted_at":"2025-07-05T10:59:00Z","title":"RepeaTTS: Towards Feature Discovery through Repeated Fine-Tuning","version":1},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-08-06T20:01:35.485659Z"},"links":{"citing_paper":"/paper/2507.08012"},"observation_digest":"sha256:f9e7c094a7971b8d7c5e1f5fc6db2c1a309b4b1a30e79fe4e8bda71d262deffb","observation_id":"08fe315f-e365-4d52-8599-2be397c9580d","resolution":{"observed_at":"2026-08-06T20:01:35.703580Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2111.09296","last_updated":"2021-12-16T18:29:22Z","snapshot_observed_at":"2026-07-06T12:09:37.468149Z","submitted_at":"2021-11-17T18:49:42Z","title":"XLS-R: Self-supervised Cross-lingual Speech Representation Learning at Scale","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2111.09296","snapshot_observed_at":"2026-08-06T20:01:35.492150Z","title":"Xls-r: Self- supervised cross-lingual speech representation learning at scale,","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2507.08012","last_updated":"2025-07-05T10:59:00Z","snapshot_observed_at":"2026-08-08T05:05:40.148191Z","submitted_at":"2025-07-05T10:59:00Z","title":"RepeaTTS: Towards Feature Discovery through Repeated Fine-Tuning","version":1},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-08-06T20:01:35.492150Z"},"links":{"cited_paper":"/paper/2111.09296","citing_paper":"/paper/2507.08012"},"observation_digest":"sha256:2b2e7e479a622ecd1a13a9d78a86a2a1ba6bc89479c2f483636f6c109008b9d7","observation_id":"6910d54b-696a-4824-9f91-cfc860254baf","resolution":{"observed_at":"2026-08-06T20:01:35.492150Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T20:01:35.495505Z","title":"wav2vec 2.0: A framework for self-supervised learning of speech repre- sentations,","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2507.08012","last_updated":"2025-07-05T10:59:00Z","snapshot_observed_at":"2026-08-08T05:05:40.148191Z","submitted_at":"2025-07-05T10:59:00Z","title":"RepeaTTS: Towards Feature Discovery through Repeated Fine-Tuning","version":1},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-08-06T20:01:35.495505Z"},"links":{"citing_paper":"/paper/2507.08012"},"observation_digest":"sha256:39d0f853794ef8bee4983c894d9f1768b23d50d5fb2f9dcad5d5276c62d57dd5","observation_id":"80cdb785-1615-43b5-a361-7059e4e8f470","resolution":{"observed_at":"2026-08-06T20:01:35.495505Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T20:01:35.498551Z","title":"Opensmile: the mu- nich versatile and fast open-source audio feature extractor,","venue":null,"work_id":null,"year":2010},"citing_paper":{"arxiv_id":"2507.08012","last_updated":"2025-07-05T10:59:00Z","snapshot_observed_at":"2026-08-08T05:05:40.148191Z","submitted_at":"2025-07-05T10:59:00Z","title":"RepeaTTS: Towards Feature Discovery through Repeated Fine-Tuning","version":1},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-08-06T20:01:35.498551Z"},"links":{"citing_paper":"/paper/2507.08012"},"observation_digest":"sha256:fe9f8e4ae0607b5dc896829b1a4bb51817e760cdf427b3fd8ee5372326b22d6d","observation_id":"1362a32a-1c55-4ff7-bf04-36afd597e180","resolution":{"observed_at":"2026-08-06T20:01:35.498551Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T20:01:35.672974Z","title":"On the utility of self-supervised mod- els for prosody-related tasks,","venue":null,"work_id":"18d93207-6cbe-40fc-9871-3b3ae548df60","year":2022},"citing_paper":{"arxiv_id":"2507.08012","last_updated":"2025-07-05T10:59:00Z","snapshot_observed_at":"2026-08-08T05:05:40.148191Z","submitted_at":"2025-07-05T10:59:00Z","title":"RepeaTTS: Towards Feature Discovery through Repeated Fine-Tuning","version":1},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-08-06T20:01:35.501687Z"},"links":{"citing_paper":"/paper/2507.08012"},"observation_digest":"sha256:97b52317cad8d736dc59256c66a69452d1abf728b6114e9c4a2acc3e560b7da4","observation_id":"d5762b8f-06b2-4f3d-880a-c835ebbef3c0","resolution":{"observed_at":"2026-08-06T20:01:35.676734Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T20:01:35.661105Z","title":"Generalized end-to-end loss for speaker verification,","venue":null,"work_id":"3e7e5dad-9c59-4590-98aa-eb67a76dd8e1","year":2018},"citing_paper":{"arxiv_id":"2507.08012","last_updated":"2025-07-05T10:59:00Z","snapshot_observed_at":"2026-08-08T05:05:40.148191Z","submitted_at":"2025-07-05T10:59:00Z","title":"RepeaTTS: Towards Feature Discovery through Repeated Fine-Tuning","version":1},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-08-06T20:01:35.504834Z"},"links":{"citing_paper":"/paper/2507.08012"},"observation_digest":"sha256:8a84b4f6015682c82b3155d7a815440c18535310faf805961a89c465dcf48bc4","observation_id":"98db6c0d-26d1-477b-91fb-902c818fde60","resolution":{"observed_at":"2026-08-06T20:01:35.664938Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2310.06825","last_updated":"2023-10-10T17:54:58Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2023-10-10T17:54:58Z","title":"Mistral 7B","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2310.06825","snapshot_observed_at":"2026-08-06T20:01:35.488845Z","title":"Available: https://arxiv.org/abs/2310.06825","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2507.08012","last_updated":"2025-07-05T10:59:00Z","snapshot_observed_at":"2026-08-08T05:05:40.148191Z","submitted_at":"2025-07-05T10:59:00Z","title":"RepeaTTS: Towards Feature Discovery through Repeated Fine-Tuning","version":1},"reference_index":2023,"source":"pdf_text","source_observed_at":"2026-08-06T20:01:35.488845Z"},"links":{"cited_paper":"/paper/2310.06825","citing_paper":"/paper/2507.08012"},"observation_digest":"sha256:db96ee9857fff065d790b1faa1c721feef86941c9cc5764eac9fbe3657a19034","observation_id":"ea4e03d3-4176-42a0-a7f0-2dbda3a4f722","resolution":{"observed_at":"2026-08-06T20:01:35.488845Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"paper":{"arxiv_id":"2507.08012","last_updated":"2025-07-05T10:59:00Z","latest_version":1,"primary_category":"cs.CL","snapshot_observed_at":"2026-08-08T05:05:40.148191Z","submitted_at":"2025-07-05T10:59:00Z","title":"RepeaTTS: Towards Feature Discovery through Repeated Fine-Tuning"},"reference_resolution":{"displayed":35,"state_counts":{"malformed_identifier":0,"metadata_mismatch":1,"parse_uncertain":0,"unresolved":13,"verified_exact":2,"verified_fuzzy":19},"total_outbound_references":35},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"thesis":"As of 9 August 2026, this Paper Citation Record lists 35 of 35 outbound references and 1 inbound Pith citation observation for arXiv:2507.08012."}