{"as_of":"2026-08-16T18:58:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:2fbf6c8b92b528d04bad74e2271cf191f77501f9c53a84116bd88fcf011fc61f","coverage":[{"denominator":38,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":38,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-06T00:40:33.570559Z","state":"measured"},{"denominator":39,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":39,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-16T06:30:59.297886+00:00","state":"measured"},{"denominator":1,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":1,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-06T00:40:30.251406Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"pith","source_observed_at":"2026-08-06T00:40:33.745238Z","state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2608.00998","last_updated":"2026-08-02T04:54:12Z","snapshot_observed_at":"2026-08-15T06:31:49.907405Z","submitted_at":"2026-08-02T04:54:12Z","title":"Beyond One-Size-Fits-All: Personalized and Culturally Adaptive Emotional TTS via Interactive Optimization of Individual Emotion Perception Spaces","version":1},"cited_work":{"arxiv_id":"2608.00998","doi":null,"metadata_source":"pith","pith_arxiv_id":"2608.00998","snapshot_observed_at":"2026-08-06T00:40:33.745238Z","title":"Beyond One-Size-Fits-All: Personalized and Culturally Adaptive Emotional TTS via Interactive Optimization of Individual Emotion Perception Spaces","venue":"eess.AS","work_id":"b98efed6-2930-4b81-a34f-83664e063f8d","year":2026},"citing_paper":{"arxiv_id":"2608.00998","last_updated":"2026-08-02T04:54:12Z","snapshot_observed_at":"2026-08-15T06:31:49.907405Z","submitted_at":"2026-08-02T04:54:12Z","title":"Beyond One-Size-Fits-All: Personalized and Culturally Adaptive Emotional TTS via Interactive Optimization of Individual Emotion Perception Spaces","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-06T00:40:30.251406Z"},"links":{"cited_paper":"/paper/2608.00998","citing_paper":"/paper/2608.00998"},"observation_digest":"sha256:3706d2b73b5b5173867ca6147fceae26e4739b552726447b307de4a50f8fd5d4","observation_id":"87dd77c5-d20d-4033-959a-e234bd80104c","resolution":{"observed_at":"2026-08-06T00:40:33.852446Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}}],"links":{"evidence":"/evidence","html":"/paper/2608.00998/citation-record","integrity":"/paper/2608.00998/integrity","json":"/paper/2608.00998/citation-record.json","paper":"/paper/2608.00998"},"outbound":[{"citation":{"cited_paper":{"arxiv_id":"2608.00998","last_updated":"2026-08-02T04:54:12Z","snapshot_observed_at":"2026-08-15T06:31:49.907405Z","submitted_at":"2026-08-02T04:54:12Z","title":"Beyond One-Size-Fits-All: Personalized and Culturally Adaptive Emotional TTS via Interactive Optimization of Individual Emotion Perception Spaces","version":1},"cited_work":{"arxiv_id":"2608.00998","doi":null,"metadata_source":"pith","pith_arxiv_id":"2608.00998","snapshot_observed_at":"2026-08-06T00:40:33.745238Z","title":"Beyond One-Size-Fits-All: Personalized and Culturally Adaptive Emotional TTS via Interactive Optimization of Individual Emotion Perception Spaces","venue":"eess.AS","work_id":"b98efed6-2930-4b81-a34f-83664e063f8d","year":2026},"citing_paper":{"arxiv_id":"2608.00998","last_updated":"2026-08-02T04:54:12Z","snapshot_observed_at":"2026-08-15T06:31:49.907405Z","submitted_at":"2026-08-02T04:54:12Z","title":"Beyond One-Size-Fits-All: Personalized and Culturally Adaptive Emotional TTS via Interactive Optimization of Individual Emotion Perception Spaces","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-06T00:40:30.251406Z"},"links":{"cited_paper":"/paper/2608.00998","citing_paper":"/paper/2608.00998"},"observation_digest":"sha256:3706d2b73b5b5173867ca6147fceae26e4739b552726447b307de4a50f8fd5d4","observation_id":"87dd77c5-d20d-4033-959a-e234bd80104c","resolution":{"observed_at":"2026-08-06T00:40:33.852446Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T00:40:37.348748Z","title":"happy,” “sad","venue":null,"work_id":"b60ad89c-b3ae-4170-90b1-c877b3a10ed6","year":null},"citing_paper":{"arxiv_id":"2608.00998","last_updated":"2026-08-02T04:54:12Z","snapshot_observed_at":"2026-08-15T06:31:49.907405Z","submitted_at":"2026-08-02T04:54:12Z","title":"Beyond One-Size-Fits-All: Personalized and Culturally Adaptive Emotional TTS via Interactive Optimization of Individual Emotion Perception Spaces","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-06T00:40:30.347861Z"},"links":{"citing_paper":"/paper/2608.00998"},"observation_digest":"sha256:8727991f1df560225771faaae1e3f45827027b35fe9af5c9b09f3765016383b6","observation_id":"476f4840-a1e4-4b47-886e-ffa429280f14","resolution":{"observed_at":"2026-08-06T00:40:37.374334Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T00:40:37.203819Z","title":"The overall archi- tecture is illustrated in Fig","venue":null,"work_id":"4b21c100-0e87-4d9c-8c9f-af640f2bd63f","year":null},"citing_paper":{"arxiv_id":"2608.00998","last_updated":"2026-08-02T04:54:12Z","snapshot_observed_at":"2026-08-15T06:31:49.907405Z","submitted_at":"2026-08-02T04:54:12Z","title":"Beyond One-Size-Fits-All: Personalized and Culturally Adaptive Emotional TTS via Interactive Optimization of Individual Emotion Perception Spaces","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-06T00:40:30.430041Z"},"links":{"citing_paper":"/paper/2608.00998"},"observation_digest":"sha256:7edb2ced1f3b298a3583ff9e8741cefcf0d9bdefec75ed148c59ff6166d6b9cf","observation_id":"cb99e9a2-78ff-4af5-aca4-66100d606a92","resolution":{"observed_at":"2026-08-06T00:40:37.278267Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T00:40:37.067928Z","title":"Dataset and Training Setup Dataset:We constructed a 9-hour American English fe- male emotional speech dataset (22.05 kHz) by combining EX- PRESSO [27], EmoV-DB [28], and ESD [9]","venue":null,"work_id":"f1421bb7-0680-4750-8cc9-8c19c17f2aa1","year":2000},"citing_paper":{"arxiv_id":"2608.00998","last_updated":"2026-08-02T04:54:12Z","snapshot_observed_at":"2026-08-15T06:31:49.907405Z","submitted_at":"2026-08-02T04:54:12Z","title":"Beyond One-Size-Fits-All: Personalized and Culturally Adaptive Emotional TTS via Interactive Optimization of Individual Emotion Perception Spaces","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-06T00:40:30.529042Z"},"links":{"citing_paper":"/paper/2608.00998"},"observation_digest":"sha256:e8bd1fc7a17658af2e809b0494adeda04f18cecef76112af451c722d3b919fd9","observation_id":"fdec17cc-6522-4e88-8b2d-a4df62d5ed53","resolution":{"observed_at":"2026-08-06T00:40:37.133107Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T00:40:36.940842Z","title":"Speech Quality and Emotional Similarity Table 1 summarizes the performance of the emotional speech generator before human-in-the-loop IGA personalization","venue":null,"work_id":"ec1a5e6e-0996-4d4d-93cf-7f5472d45038","year":null},"citing_paper":{"arxiv_id":"2608.00998","last_updated":"2026-08-02T04:54:12Z","snapshot_observed_at":"2026-08-15T06:31:49.907405Z","submitted_at":"2026-08-02T04:54:12Z","title":"Beyond One-Size-Fits-All: Personalized and Culturally Adaptive Emotional TTS via Interactive Optimization of Individual Emotion Perception Spaces","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-06T00:40:30.602687Z"},"links":{"citing_paper":"/paper/2608.00998"},"observation_digest":"sha256:ad26da61d8e5f15012ef3b6819d71e1cb9f5c663e9092a4496edbf8507d092d4","observation_id":"67fc78a8-aa8c-4c5c-bcf7-92dbc7f62031","resolution":{"observed_at":"2026-08-06T00:40:37.021864Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T00:40:36.789207Z","title":null,"venue":null,"work_id":"c66a39e6-a5db-4bed-95a5-0e88d83413ff","year":null},"citing_paper":{"arxiv_id":"2608.00998","last_updated":"2026-08-02T04:54:12Z","snapshot_observed_at":"2026-08-15T06:31:49.907405Z","submitted_at":"2026-08-02T04:54:12Z","title":"Beyond One-Size-Fits-All: Personalized and Culturally Adaptive Emotional TTS via Interactive Optimization of Individual Emotion Perception Spaces","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-06T00:40:30.665976Z"},"links":{"citing_paper":"/paper/2608.00998"},"observation_digest":"sha256:1ad3ca60870d8c4ecd438c16d26e6668ec13bb6b486c443872f729517f58d871","observation_id":"60568f40-bf3b-4f67-8a45-3481e31f7328","resolution":{"observed_at":"2026-08-06T00:40:36.888921Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T00:40:36.685625Z","title":null,"venue":null,"work_id":"b6a3aa34-bf76-4ba0-871e-87e537d98354","year":null},"citing_paper":{"arxiv_id":"2608.00998","last_updated":"2026-08-02T04:54:12Z","snapshot_observed_at":"2026-08-15T06:31:49.907405Z","submitted_at":"2026-08-02T04:54:12Z","title":"Beyond One-Size-Fits-All: Personalized and Culturally Adaptive Emotional TTS via Interactive Optimization of Individual Emotion Perception Spaces","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-06T00:40:30.788230Z"},"links":{"citing_paper":"/paper/2608.00998"},"observation_digest":"sha256:562da26e406b9f1ca229ecec5de77cfcd10f12645303e1ca88f9a824b34c4fa8","observation_id":"e3e731d8-d12e-4c83-ba15-6da378de5416","resolution":{"observed_at":"2026-08-06T00:40:36.743917Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T00:40:36.563637Z","title":null,"venue":null,"work_id":"98e283fc-1612-4213-b242-34df6ebd3c9d","year":null},"citing_paper":{"arxiv_id":"2608.00998","last_updated":"2026-08-02T04:54:12Z","snapshot_observed_at":"2026-08-15T06:31:49.907405Z","submitted_at":"2026-08-02T04:54:12Z","title":"Beyond One-Size-Fits-All: Personalized and Culturally Adaptive Emotional TTS via Interactive Optimization of Individual Emotion Perception Spaces","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-06T00:40:30.836577Z"},"links":{"citing_paper":"/paper/2608.00998"},"observation_digest":"sha256:d4caaef44d9fdcc37eecb0216fb090d70070594b4045cc68e3db388fbb7072e2","observation_id":"ec7d53b9-2773-457a-ba68-50620023c3aa","resolution":{"observed_at":"2026-08-06T00:40:36.616598Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T00:40:36.428921Z","title":"Gender and culture differences in emotion","venue":null,"work_id":"15050010-0af8-4a77-ac67-c00451b574ea","year":2004},"citing_paper":{"arxiv_id":"2608.00998","last_updated":"2026-08-02T04:54:12Z","snapshot_observed_at":"2026-08-15T06:31:49.907405Z","submitted_at":"2026-08-02T04:54:12Z","title":"Beyond One-Size-Fits-All: Personalized and Culturally Adaptive Emotional TTS via Interactive Optimization of Individual Emotion Perception Spaces","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-06T00:40:30.937171Z"},"links":{"citing_paper":"/paper/2608.00998"},"observation_digest":"sha256:2be69a35e38dc2b6faba5463098a00c3e3aadfb4a47054b5c4f33147ed05432c","observation_id":"8db80bbf-936f-483a-b44f-caee1b988950","resolution":{"observed_at":"2026-08-06T00:40:36.472364Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T00:40:36.299687Z","title":"Plutchik and H","venue":null,"work_id":"0abe2a40-4b43-4503-8c79-d1cf719428aa","year":2013},"citing_paper":{"arxiv_id":"2608.00998","last_updated":"2026-08-02T04:54:12Z","snapshot_observed_at":"2026-08-15T06:31:49.907405Z","submitted_at":"2026-08-02T04:54:12Z","title":"Beyond One-Size-Fits-All: Personalized and Culturally Adaptive Emotional TTS via Interactive Optimization of Individual Emotion Perception Spaces","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-06T00:40:31.046065Z"},"links":{"citing_paper":"/paper/2608.00998"},"observation_digest":"sha256:35f731d0b5f629dc467daf9a99e135a446738977ddab19b8df796617f88b0d3a","observation_id":"7c14b4bd-c2e6-4928-96ec-5d3bb94701bc","resolution":{"observed_at":"2026-08-06T00:40:36.333999Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T00:40:31.114160Z","title":"A circumplex model of affect","venue":null,"work_id":null,"year":1980},"citing_paper":{"arxiv_id":"2608.00998","last_updated":"2026-08-02T04:54:12Z","snapshot_observed_at":"2026-08-15T06:31:49.907405Z","submitted_at":"2026-08-02T04:54:12Z","title":"Beyond One-Size-Fits-All: Personalized and Culturally Adaptive Emotional TTS via Interactive Optimization of Individual Emotion Perception Spaces","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-06T00:40:31.114160Z"},"links":{"citing_paper":"/paper/2608.00998"},"observation_digest":"sha256:938d532a9f56742d654c71188ad8adc1c6e01dc4a792ec8c6d860c39edfa36e6","observation_id":"d537065b-afdc-4fe7-9240-8da84afb3e8f","resolution":{"observed_at":"2026-08-06T00:40:31.114160Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T00:40:36.176751Z","title":"Matcha-tts: A fast tts architecture with conditional flow match- ing,","venue":null,"work_id":"50dac78c-c983-4ff8-9727-05060f959d3e","year":2024},"citing_paper":{"arxiv_id":"2608.00998","last_updated":"2026-08-02T04:54:12Z","snapshot_observed_at":"2026-08-15T06:31:49.907405Z","submitted_at":"2026-08-02T04:54:12Z","title":"Beyond One-Size-Fits-All: Personalized and Culturally Adaptive Emotional TTS via Interactive Optimization of Individual Emotion Perception Spaces","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-06T00:40:31.267269Z"},"links":{"citing_paper":"/paper/2608.00998"},"observation_digest":"sha256:d620d0bf75032d89f185f8cc8cc66ee9ccddea163d91049e025deaa84c8d1106","observation_id":"8f0a4d78-256b-420b-8680-a819c73d70ad","resolution":{"observed_at":"2026-08-06T00:40:36.247515Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T00:40:36.022556Z","title":"F5-tts: A fairytaler that fakes fluent and faithful speech with flow matching,","venue":null,"work_id":"5f21b248-1f99-47ee-a50b-30570dfc2492","year":2025},"citing_paper":{"arxiv_id":"2608.00998","last_updated":"2026-08-02T04:54:12Z","snapshot_observed_at":"2026-08-15T06:31:49.907405Z","submitted_at":"2026-08-02T04:54:12Z","title":"Beyond One-Size-Fits-All: Personalized and Culturally Adaptive Emotional TTS via Interactive Optimization of Individual Emotion Perception Spaces","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-06T00:40:31.345222Z"},"links":{"citing_paper":"/paper/2608.00998"},"observation_digest":"sha256:ccd999b4ea9d19c605fcb956fd7925ca0ad8c23c78fdb4e5411b2acbf3ed7d1f","observation_id":"0fe06c2e-1dd2-4760-a7f6-e76420d936dd","resolution":{"observed_at":"2026-08-06T00:40:36.095107Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2304.09116","last_updated":"2023-05-30T16:09:10Z","snapshot_observed_at":"2026-08-16T15:39:31.485174Z","submitted_at":"2023-04-18T16:31:59Z","title":"NaturalSpeech 2: Latent Diffusion Models are Natural and Zero-Shot Speech and Singing Synthesizers","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2304.09116","snapshot_observed_at":"2026-08-06T00:40:31.445968Z","title":"Naturalspeech 2: Latent diffusion models are natu- ral and zero-shot speech and singing synthesizers,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2608.00998","last_updated":"2026-08-02T04:54:12Z","snapshot_observed_at":"2026-08-15T06:31:49.907405Z","submitted_at":"2026-08-02T04:54:12Z","title":"Beyond One-Size-Fits-All: Personalized and Culturally Adaptive Emotional TTS via Interactive Optimization of Individual Emotion Perception Spaces","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-06T00:40:31.445968Z"},"links":{"cited_paper":"/paper/2304.09116","citing_paper":"/paper/2608.00998"},"observation_digest":"sha256:2c88b7c7b5cb7100e8459820f5ccc04d085e84165efef1ec8fad6d60c1ecc6ba","observation_id":"43fc6afc-8c13-4382-8c7d-7ab8c9e49b12","resolution":{"observed_at":"2026-08-06T00:40:31.445968Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T00:40:35.887106Z","title":"Styletts 2: Towards human-level text-to-speech through style dif- fusion and adversarial training with large speech language mod- els,","venue":null,"work_id":"c53ab173-6bcb-4d49-a62c-957d631eb9a8","year":2023},"citing_paper":{"arxiv_id":"2608.00998","last_updated":"2026-08-02T04:54:12Z","snapshot_observed_at":"2026-08-15T06:31:49.907405Z","submitted_at":"2026-08-02T04:54:12Z","title":"Beyond One-Size-Fits-All: Personalized and Culturally Adaptive Emotional TTS via Interactive Optimization of Individual Emotion Perception Spaces","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-06T00:40:31.545433Z"},"links":{"citing_paper":"/paper/2608.00998"},"observation_digest":"sha256:5acc194a50535cefe1fac0f102cf5a6f89620d7b332fa900dbc3b55256c04cb1","observation_id":"de92c9e1-4f62-4423-8f7b-2bfbf6e60422","resolution":{"observed_at":"2026-08-06T00:40:35.950183Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T00:40:35.792080Z","title":"Deep learning-based expressive speech synthesis: a systematic review of approaches, challenges, and resources,","venue":null,"work_id":"f6d9eaee-b940-414f-93b1-1b225e866e16","year":2024},"citing_paper":{"arxiv_id":"2608.00998","last_updated":"2026-08-02T04:54:12Z","snapshot_observed_at":"2026-08-15T06:31:49.907405Z","submitted_at":"2026-08-02T04:54:12Z","title":"Beyond One-Size-Fits-All: Personalized and Culturally Adaptive Emotional TTS via Interactive Optimization of Individual Emotion Perception Spaces","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-06T00:40:31.668538Z"},"links":{"citing_paper":"/paper/2608.00998"},"observation_digest":"sha256:b0c5eafb0876be9465ea0c781cc8ed53fc0c02f08b909f428699cdfb265f4ef0","observation_id":"e13e5cb2-c75c-4a3f-9135-8c9c75a16f9f","resolution":{"observed_at":"2026-08-06T00:40:35.807134Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T00:40:31.729302Z","title":"Emotional voice con- version: Theory, databases and esd,","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2608.00998","last_updated":"2026-08-02T04:54:12Z","snapshot_observed_at":"2026-08-15T06:31:49.907405Z","submitted_at":"2026-08-02T04:54:12Z","title":"Beyond One-Size-Fits-All: Personalized and Culturally Adaptive Emotional TTS via Interactive Optimization of Individual Emotion Perception Spaces","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-06T00:40:31.729302Z"},"links":{"citing_paper":"/paper/2608.00998"},"observation_digest":"sha256:755311a9319c80adfca6c594fe824ef1b28ae2be115cbf9f8879dd14ac039e27","observation_id":"15eefaf9-2e45-4268-8cb1-e2e339b63e16","resolution":{"observed_at":"2026-08-06T00:40:31.729302Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2307.00024","last_updated":"2023-06-28T19:34:16Z","snapshot_observed_at":"2026-08-16T15:20:16.080082Z","submitted_at":"2023-06-28T19:34:16Z","title":"EmoSpeech: Guiding FastSpeech2 Towards Emotional Text to Speech","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2307.00024","snapshot_observed_at":"2026-08-06T00:40:31.803047Z","title":"Emospeech: Guiding fast- speech2 towards emotional text to speech,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2608.00998","last_updated":"2026-08-02T04:54:12Z","snapshot_observed_at":"2026-08-15T06:31:49.907405Z","submitted_at":"2026-08-02T04:54:12Z","title":"Beyond One-Size-Fits-All: Personalized and Culturally Adaptive Emotional TTS via Interactive Optimization of Individual Emotion Perception Spaces","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-06T00:40:31.803047Z"},"links":{"cited_paper":"/paper/2307.00024","citing_paper":"/paper/2608.00998"},"observation_digest":"sha256:d6fce727ee0c71cd5b92b53eedecd87e4d6b9410fb2f51585d67d1f3715667b2","observation_id":"5677a6ab-52a9-4e6b-9959-4381e03d0394","resolution":{"observed_at":"2026-08-06T00:40:31.803047Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T00:40:35.638264Z","title":"Emo-dpo: Controllable emotional speech synthesis through direct preference optimization,","venue":null,"work_id":"0d76c0fb-c978-4a3f-8198-e7a729538645","year":2025},"citing_paper":{"arxiv_id":"2608.00998","last_updated":"2026-08-02T04:54:12Z","snapshot_observed_at":"2026-08-15T06:31:49.907405Z","submitted_at":"2026-08-02T04:54:12Z","title":"Beyond One-Size-Fits-All: Personalized and Culturally Adaptive Emotional TTS via Interactive Optimization of Individual Emotion Perception Spaces","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-06T00:40:31.874922Z"},"links":{"citing_paper":"/paper/2608.00998"},"observation_digest":"sha256:6a1c5fafaac93ce3773c542ec43cebc0fdf19a4f9becc65f091ed4ba0a74ec18","observation_id":"5016b677-dd33-4a12-8fb2-e42d234a6b44","resolution":{"observed_at":"2026-08-06T00:40:35.707838Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2406.07803","last_updated":"2024-11-04T21:39:21Z","snapshot_observed_at":"2026-08-16T13:43:57.246077Z","submitted_at":"2024-06-12T01:40:29Z","title":"EmoSphere-TTS: Emotional Style and Intensity Modeling via Spherical Emotion Vector for Controllable Emotional Text-to-Speech","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2406.07803","snapshot_observed_at":"2026-08-06T00:40:31.981929Z","title":"Emosphere-tts: Emotional style and intensity modeling via spherical emotion vector for controllable emotional text-to- speech,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2608.00998","last_updated":"2026-08-02T04:54:12Z","snapshot_observed_at":"2026-08-15T06:31:49.907405Z","submitted_at":"2026-08-02T04:54:12Z","title":"Beyond One-Size-Fits-All: Personalized and Culturally Adaptive Emotional TTS via Interactive Optimization of Individual Emotion Perception Spaces","version":1},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-06T00:40:31.981929Z"},"links":{"cited_paper":"/paper/2406.07803","citing_paper":"/paper/2608.00998"},"observation_digest":"sha256:f3feecb2089455e82757ddbb3730a730e2582bb456850ada172c50d2f545af86","observation_id":"65497633-8d62-4147-9814-61760154a903","resolution":{"observed_at":"2026-08-06T00:40:31.981929Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T00:40:35.508959Z","title":"Emo- sphere++: Emotion-controllable zero-shot text-to-speech via emotion-adaptive spherical vector,","venue":null,"work_id":"df3415e5-e44d-41c6-9ef1-a920aa0de5b5","year":2025},"citing_paper":{"arxiv_id":"2608.00998","last_updated":"2026-08-02T04:54:12Z","snapshot_observed_at":"2026-08-15T06:31:49.907405Z","submitted_at":"2026-08-02T04:54:12Z","title":"Beyond One-Size-Fits-All: Personalized and Culturally Adaptive Emotional TTS via Interactive Optimization of Individual Emotion Perception Spaces","version":1},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-06T00:40:32.063046Z"},"links":{"citing_paper":"/paper/2608.00998"},"observation_digest":"sha256:73c362924d79ecc75e2dc4b5308db5dc03d805b24d59682be73fd5aa1fd7ed54","observation_id":"8bff6bd7-7293-46d7-8adc-f8831b139de6","resolution":{"observed_at":"2026-08-06T00:40:35.578040Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T00:40:35.344963Z","title":"Ece-tts: A zero-shot emotion text-to-speech model with simplified and precise control,","venue":null,"work_id":"dbd59cf0-82d2-42ee-a0fd-3c5328e9d8bf","year":2025},"citing_paper":{"arxiv_id":"2608.00998","last_updated":"2026-08-02T04:54:12Z","snapshot_observed_at":"2026-08-15T06:31:49.907405Z","submitted_at":"2026-08-02T04:54:12Z","title":"Beyond One-Size-Fits-All: Personalized and Culturally Adaptive Emotional TTS via Interactive Optimization of Individual Emotion Perception Spaces","version":1},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-06T00:40:32.161696Z"},"links":{"citing_paper":"/paper/2608.00998"},"observation_digest":"sha256:becd5702811fc9bfabfcd702474796e6f60b83953c82f69be6337834f40de467","observation_id":"624643ac-4e99-4a8e-8e76-abd4b4700f16","resolution":{"observed_at":"2026-08-06T00:40:35.435343Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T00:40:35.259184Z","title":"Train- ing language models to follow instructions with human feedback,","venue":null,"work_id":"f3a108cd-707d-4d38-88f6-b6a81075e58b","year":2022},"citing_paper":{"arxiv_id":"2608.00998","last_updated":"2026-08-02T04:54:12Z","snapshot_observed_at":"2026-08-15T06:31:49.907405Z","submitted_at":"2026-08-02T04:54:12Z","title":"Beyond One-Size-Fits-All: Personalized and Culturally Adaptive Emotional TTS via Interactive Optimization of Individual Emotion Perception Spaces","version":1},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-06T00:40:32.277630Z"},"links":{"citing_paper":"/paper/2608.00998"},"observation_digest":"sha256:e3e8ed6dacc327cbba82d243fb42d80e9d6cf992412a49ed38b7ace8c298abe8","observation_id":"2c770e51-00f1-4861-8173-4acb0f792a0d","resolution":{"observed_at":"2026-08-06T00:40:35.301686Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T00:40:35.114657Z","title":"A survey of reinforcement learning from human feedback,","venue":null,"work_id":"c819f659-f8de-4b45-902d-54a8f12fa15c","year":2024},"citing_paper":{"arxiv_id":"2608.00998","last_updated":"2026-08-02T04:54:12Z","snapshot_observed_at":"2026-08-15T06:31:49.907405Z","submitted_at":"2026-08-02T04:54:12Z","title":"Beyond One-Size-Fits-All: Personalized and Culturally Adaptive Emotional TTS via Interactive Optimization of Individual Emotion Perception Spaces","version":1},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-06T00:40:32.363036Z"},"links":{"citing_paper":"/paper/2608.00998"},"observation_digest":"sha256:bb3bcc6f9405e868d8d490b5bb53865557b900c0eca76ca6d33e7cbb12f2ce2a","observation_id":"06ce9602-19e3-4ba2-b248-c7625b77afae","resolution":{"observed_at":"2026-08-06T00:40:35.176451Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T00:40:34.975425Z","title":"Towards creative evolutionary systems with interac- tive genetic algorithm,","venue":null,"work_id":"d79cfc0a-8a86-486a-982a-16b7ad9f6017","year":2002},"citing_paper":{"arxiv_id":"2608.00998","last_updated":"2026-08-02T04:54:12Z","snapshot_observed_at":"2026-08-15T06:31:49.907405Z","submitted_at":"2026-08-02T04:54:12Z","title":"Beyond One-Size-Fits-All: Personalized and Culturally Adaptive Emotional TTS via Interactive Optimization of Individual Emotion Perception Spaces","version":1},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-08-06T00:40:32.475286Z"},"links":{"citing_paper":"/paper/2608.00998"},"observation_digest":"sha256:812861f9b800d2291b3a16443595dc37a3ea6eabef038e65776182fc88096654","observation_id":"d8a846b0-8a87-4368-8c18-8ec14a2e2733","resolution":{"observed_at":"2026-08-06T00:40:35.015952Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1810.07217","last_updated":"2018-12-27T06:50:41Z","snapshot_observed_at":"2026-08-14T18:13:38.548293Z","submitted_at":"2018-10-16T18:20:02Z","title":"Hierarchical Generative Modeling for Controllable Speech Synthesis","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1810.07217","snapshot_observed_at":"2026-08-06T00:40:32.535351Z","title":"Hierarchical genera- tive modeling for controllable speech synthesis,","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2608.00998","last_updated":"2026-08-02T04:54:12Z","snapshot_observed_at":"2026-08-15T06:31:49.907405Z","submitted_at":"2026-08-02T04:54:12Z","title":"Beyond One-Size-Fits-All: Personalized and Culturally Adaptive Emotional TTS via Interactive Optimization of Individual Emotion Perception Spaces","version":1},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-08-06T00:40:32.535351Z"},"links":{"cited_paper":"/paper/1810.07217","citing_paper":"/paper/2608.00998"},"observation_digest":"sha256:a32a07d7d6b9f901f6ab1164083c3b6a18aa07672c1ad243a07a87532607c401","observation_id":"523abf36-8c69-4e8c-81a0-454091c9705c","resolution":{"observed_at":"2026-08-06T00:40:32.535351Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T00:40:32.619041Z","title":"Natural tts synthesis by conditioning wavenet on mel spectrogram pre- dictions,","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2608.00998","last_updated":"2026-08-02T04:54:12Z","snapshot_observed_at":"2026-08-15T06:31:49.907405Z","submitted_at":"2026-08-02T04:54:12Z","title":"Beyond One-Size-Fits-All: Personalized and Culturally Adaptive Emotional TTS via Interactive Optimization of Individual Emotion Perception Spaces","version":1},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-08-06T00:40:32.619041Z"},"links":{"citing_paper":"/paper/2608.00998"},"observation_digest":"sha256:3611f960f0f5f38a6ce83a94e7c493d56dbceed680375dc19f632512d61e5824","observation_id":"371d7791-a45d-4849-b532-ba03c33b012c","resolution":{"observed_at":"2026-08-06T00:40:32.619041Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T00:40:34.812785Z","title":"Yourtts: Towards zero-shot multi-speaker tts and zero-shot voice conversion for everyone,","venue":null,"work_id":"5ac0583b-9ad2-45c6-ba7e-c021ee424cd2","year":2022},"citing_paper":{"arxiv_id":"2608.00998","last_updated":"2026-08-02T04:54:12Z","snapshot_observed_at":"2026-08-15T06:31:49.907405Z","submitted_at":"2026-08-02T04:54:12Z","title":"Beyond One-Size-Fits-All: Personalized and Culturally Adaptive Emotional TTS via Interactive Optimization of Individual Emotion Perception Spaces","version":1},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-08-06T00:40:32.706485Z"},"links":{"citing_paper":"/paper/2608.00998"},"observation_digest":"sha256:fcb1005733583ef49abec5aaefc1d7732fc639c17c75d857c8dfa0b4d7482e83","observation_id":"d9114ced-9711-468d-9f36-4bde37d4cca3","resolution":{"observed_at":"2026-08-06T00:40:34.888705Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T00:40:34.667988Z","title":"A review on genetic algorithm: past, present, and future,","venue":null,"work_id":"de45e680-8f48-4eb5-8e0e-4658c55bbe90","year":2021},"citing_paper":{"arxiv_id":"2608.00998","last_updated":"2026-08-02T04:54:12Z","snapshot_observed_at":"2026-08-15T06:31:49.907405Z","submitted_at":"2026-08-02T04:54:12Z","title":"Beyond One-Size-Fits-All: Personalized and Culturally Adaptive Emotional TTS via Interactive Optimization of Individual Emotion Perception Spaces","version":1},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-08-06T00:40:32.815243Z"},"links":{"citing_paper":"/paper/2608.00998"},"observation_digest":"sha256:3de3f76e058308baefec7b85850de6dfea18989f172bc8372bb54eef891d26d3","observation_id":"5309c1f2-0736-4be8-ae0d-426defedd13d","resolution":{"observed_at":"2026-08-06T00:40:34.761534Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T00:40:34.515807Z","title":"Optimization of sound of au- tonomous sensory meridian response with interactive genetic al- gorithm,","venue":null,"work_id":"45da3b21-6d1f-442d-a262-4acd19dca2f6","year":2020},"citing_paper":{"arxiv_id":"2608.00998","last_updated":"2026-08-02T04:54:12Z","snapshot_observed_at":"2026-08-15T06:31:49.907405Z","submitted_at":"2026-08-02T04:54:12Z","title":"Beyond One-Size-Fits-All: Personalized and Culturally Adaptive Emotional TTS via Interactive Optimization of Individual Emotion Perception Spaces","version":1},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-08-06T00:40:32.868607Z"},"links":{"citing_paper":"/paper/2608.00998"},"observation_digest":"sha256:16068e0c3b42cfad294ecefa1ef9cbe57cef0164d190f6b18addf5a5693d74f6","observation_id":"348e1d3b-d88e-4414-8331-242627fae2e7","resolution":{"observed_at":"2026-08-06T00:40:34.598701Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T00:40:34.373946Z","title":"Evolutionary process indi- cators for active igas applied to weight tuning in unit selection tts synthesis,","venue":null,"work_id":"9e67ac16-c9ea-4c68-a880-ef7591885d66","year":2010},"citing_paper":{"arxiv_id":"2608.00998","last_updated":"2026-08-02T04:54:12Z","snapshot_observed_at":"2026-08-15T06:31:49.907405Z","submitted_at":"2026-08-02T04:54:12Z","title":"Beyond One-Size-Fits-All: Personalized and Culturally Adaptive Emotional TTS via Interactive Optimization of Individual Emotion Perception Spaces","version":1},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-08-06T00:40:32.988519Z"},"links":{"citing_paper":"/paper/2608.00998"},"observation_digest":"sha256:6e3d41251ee915628f15b84c8ef2c4cac6f38f1a847d53642e7ea066df80d1b7","observation_id":"027e3eca-243a-44b9-9fcd-a70791aefa94","resolution":{"observed_at":"2026-08-06T00:40:34.448311Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T00:40:33.055255Z","title":"Grad-tts: A diffusion probabilistic model for text-to-speech,","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2608.00998","last_updated":"2026-08-02T04:54:12Z","snapshot_observed_at":"2026-08-15T06:31:49.907405Z","submitted_at":"2026-08-02T04:54:12Z","title":"Beyond One-Size-Fits-All: Personalized and Culturally Adaptive Emotional TTS via Interactive Optimization of Individual Emotion Perception Spaces","version":1},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-08-06T00:40:33.055255Z"},"links":{"citing_paper":"/paper/2608.00998"},"observation_digest":"sha256:e96573797746e29d1de433abd1acf5a07cd45d78484af76467589fbfb136464e","observation_id":"a5a7032c-70ef-4898-85bf-ab7f8fe6a604","resolution":{"observed_at":"2026-08-06T00:40:33.055255Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2006.04558","last_updated":"2022-08-08T01:53:05Z","snapshot_observed_at":"2026-08-14T02:11:04.009144Z","submitted_at":"2020-06-08T13:05:40Z","title":"FastSpeech 2: Fast and High-Quality End-to-End Text to Speech","version":8},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2006.04558","snapshot_observed_at":"2026-08-06T00:40:33.129335Z","title":"Fastspeech 2: Fast and high-quality end-to-end text to speech,","venue":null,"work_id":null,"year":2006},"citing_paper":{"arxiv_id":"2608.00998","last_updated":"2026-08-02T04:54:12Z","snapshot_observed_at":"2026-08-15T06:31:49.907405Z","submitted_at":"2026-08-02T04:54:12Z","title":"Beyond One-Size-Fits-All: Personalized and Culturally Adaptive Emotional TTS via Interactive Optimization of Individual Emotion Perception Spaces","version":1},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-08-06T00:40:33.129335Z"},"links":{"cited_paper":"/paper/2006.04558","citing_paper":"/paper/2608.00998"},"observation_digest":"sha256:6c6dd6a9db4f462dfd4f627b7b7308830a70ac3e5c7cb341e64a59e9b4f08a73","observation_id":"b272a6a6-74fa-42e1-a810-a34233ee9888","resolution":{"observed_at":"2026-08-06T00:40:33.129335Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T00:40:34.235483Z","title":"Dawn of the trans- former era in speech emotion recognition: Closing the valence gap,","venue":null,"work_id":"60f1d0e5-16ea-4a07-937d-27171969e1ca","year":2023},"citing_paper":{"arxiv_id":"2608.00998","last_updated":"2026-08-02T04:54:12Z","snapshot_observed_at":"2026-08-15T06:31:49.907405Z","submitted_at":"2026-08-02T04:54:12Z","title":"Beyond One-Size-Fits-All: Personalized and Culturally Adaptive Emotional TTS via Interactive Optimization of Individual Emotion Perception Spaces","version":1},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-08-06T00:40:33.204592Z"},"links":{"citing_paper":"/paper/2608.00998"},"observation_digest":"sha256:ed896e47866d5e9926abeb37c44624213382ab0c4874c0e46cb2c731777ebcd2","observation_id":"35a9640d-cc1f-408d-88db-b4b8edc9f65e","resolution":{"observed_at":"2026-08-06T00:40:34.308425Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2308.05725","last_updated":"2023-08-10T17:41:19Z","snapshot_observed_at":"2026-08-16T15:09:17.839357Z","submitted_at":"2023-08-10T17:41:19Z","title":"EXPRESSO: A Benchmark and Analysis of Discrete Expressive Speech Resynthesis","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2308.05725","snapshot_observed_at":"2026-08-06T00:40:33.274250Z","title":"Ex- presso: A benchmark and analysis of discrete expressive speech resynthesis,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2608.00998","last_updated":"2026-08-02T04:54:12Z","snapshot_observed_at":"2026-08-15T06:31:49.907405Z","submitted_at":"2026-08-02T04:54:12Z","title":"Beyond One-Size-Fits-All: Personalized and Culturally Adaptive Emotional TTS via Interactive Optimization of Individual Emotion Perception Spaces","version":1},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-08-06T00:40:33.274250Z"},"links":{"cited_paper":"/paper/2308.05725","citing_paper":"/paper/2608.00998"},"observation_digest":"sha256:5471091da34185aa88fe819739def15c8bb5547aedf7a462c05a65794a6bd67b","observation_id":"fec8ed68-93ac-427b-a97e-d3dea908ede9","resolution":{"observed_at":"2026-08-06T00:40:33.274250Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1806.09514","last_updated":"2018-06-25T15:01:54Z","snapshot_observed_at":"2026-08-14T18:59:34.605079Z","submitted_at":"2018-06-25T15:01:54Z","title":"The Emotional Voices Database: Towards Controlling the Emotion Dimension in Voice Generation Systems","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1806.09514","snapshot_observed_at":"2026-08-06T00:40:33.372841Z","title":"The emotional voices database: Towards controlling the emotion dimension in voice generation systems,","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2608.00998","last_updated":"2026-08-02T04:54:12Z","snapshot_observed_at":"2026-08-15T06:31:49.907405Z","submitted_at":"2026-08-02T04:54:12Z","title":"Beyond One-Size-Fits-All: Personalized and Culturally Adaptive Emotional TTS via Interactive Optimization of Individual Emotion Perception Spaces","version":1},"reference_index":36,"source":"pdf_text","source_observed_at":"2026-08-06T00:40:33.372841Z"},"links":{"cited_paper":"/paper/1806.09514","citing_paper":"/paper/2608.00998"},"observation_digest":"sha256:bf9f3372da48593f8dc4b8a5a3876098c2cb9c75817aad735f45257b932a4ae4","observation_id":"070f1d6b-6366-4d50-8d63-e7bb95e6adf7","resolution":{"observed_at":"2026-08-06T00:40:33.372841Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T00:40:34.060547Z","title":"HiFi-GAN: Generative adversar- ial networks for efficient and high fidelity speech synthesis,","venue":null,"work_id":"4f2de8a5-e067-40dd-a8fd-bac267b49a73","year":2020},"citing_paper":{"arxiv_id":"2608.00998","last_updated":"2026-08-02T04:54:12Z","snapshot_observed_at":"2026-08-15T06:31:49.907405Z","submitted_at":"2026-08-02T04:54:12Z","title":"Beyond One-Size-Fits-All: Personalized and Culturally Adaptive Emotional TTS via Interactive Optimization of Individual Emotion Perception Spaces","version":1},"reference_index":37,"source":"pdf_text","source_observed_at":"2026-08-06T00:40:33.471015Z"},"links":{"citing_paper":"/paper/2608.00998"},"observation_digest":"sha256:d1099af1b23e43218435e361db1f4251923d729cbfc6ff1b04be31538eea93bb","observation_id":"ef8f98d2-9986-42b2-8b50-0344c31779a9","resolution":{"observed_at":"2026-08-06T00:40:34.156060Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T00:40:33.947807Z","title":"Evaluation of error- And correlation- based loss functions for multitask learning dimensional speech emotion recognition,","venue":null,"work_id":"a21cc02a-035c-4ab3-b26d-d1f965efa0dd","year":2021},"citing_paper":{"arxiv_id":"2608.00998","last_updated":"2026-08-02T04:54:12Z","snapshot_observed_at":"2026-08-15T06:31:49.907405Z","submitted_at":"2026-08-02T04:54:12Z","title":"Beyond One-Size-Fits-All: Personalized and Culturally Adaptive Emotional TTS via Interactive Optimization of Individual Emotion Perception Spaces","version":1},"reference_index":38,"source":"pdf_text","source_observed_at":"2026-08-06T00:40:33.570559Z"},"links":{"citing_paper":"/paper/2608.00998"},"observation_digest":"sha256:06fb41af1080942c21369ead02740d3e9fb5f337c772de2e57ce0ac54f81e7a2","observation_id":"512f789f-8bad-45af-8a98-9bc54dc0a140","resolution":{"observed_at":"2026-08-06T00:40:33.985820Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}}],"paper":{"arxiv_id":"2608.00998","last_updated":"2026-08-02T04:54:12Z","latest_version":1,"primary_category":"eess.AS","snapshot_observed_at":"2026-08-15T06:31:49.907405Z","submitted_at":"2026-08-02T04:54:12Z","title":"Beyond One-Size-Fits-All: Personalized and Culturally Adaptive Emotional TTS via Interactive Optimization of Individual Emotion Perception Spaces"},"reference_resolution":{"displayed":38,"state_counts":{"malformed_identifier":0,"metadata_mismatch":1,"parse_uncertain":0,"unresolved":14,"verified_exact":0,"verified_fuzzy":23},"total_outbound_references":38},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"thesis":"As of 16 August 2026, this Paper Citation Record lists 38 of 38 outbound references and 1 inbound Pith citation observation for arXiv:2608.00998."}