{"as_of":"2026-08-10T08:01:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:5315d6698cdf198e384387fe70b0af177e52bd09ad7136a0786148a977a510e5","coverage":[{"denominator":0,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":6,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":6,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-10T06:31:04.303077+00:00","state":"measured"},{"denominator":6,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":6,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-06T00:40:31.981929Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"arxiv_reference","source_observed_at":"2026-07-03T16:08:37.822741Z","state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2406.07803","last_updated":"2024-11-04T21:39:21Z","snapshot_observed_at":"2026-07-06T18:29:17.280082Z","submitted_at":"2024-06-12T01:40:29Z","title":"EmoSphere-TTS: Emotional Style and Intensity Modeling via Spherical Emotion Vector for Controllable Emotional Text-to-Speech","version":2},"cited_work":{"arxiv_id":"2406.07803","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2406.07803","snapshot_observed_at":"2026-07-03T16:08:37.822741Z","title":"Emosphere-tts: Emo- tional style and intensity modeling via spherical emotion vec- tor for controllable emotional text-to-speech","venue":null,"work_id":"e29f9e9f-cdc0-4e3f-90fe-3a0f11f45b68","year":2024},"citing_paper":{"arxiv_id":"2510.13293","last_updated":"2026-06-10T05:54:25Z","snapshot_observed_at":"2026-08-04T09:49:40.217695Z","submitted_at":"2025-10-15T08:37:16Z","title":"Cross-modal Consistency Guidance for Robust Emotion Control in Auto-Regressive TTS Models","version":2},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-05-18T07:42:43.077644Z"},"links":{"cited_paper":"/paper/2406.07803","citing_paper":"/paper/2510.13293"},"observation_digest":"sha256:291c9d0f71a72790506a6c6e332c22364891061d90a6c36aab2d28b36d7a892a","observation_id":"f8bfc103-a260-4e6e-ab61-bfec72408b9a","resolution":{"observed_at":"2026-05-18T07:46:03.613293Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2406.07803","last_updated":"2024-11-04T21:39:21Z","snapshot_observed_at":"2026-07-06T18:29:17.280082Z","submitted_at":"2024-06-12T01:40:29Z","title":"EmoSphere-TTS: Emotional Style and Intensity Modeling via Spherical Emotion Vector for Controllable Emotional Text-to-Speech","version":2},"cited_work":{"arxiv_id":"2406.07803","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2406.07803","snapshot_observed_at":"2026-07-03T16:08:37.822741Z","title":"Emosphere-tts: Emo- tional style and intensity modeling via spherical emotion vec- tor for controllable emotional text-to-speech","venue":null,"work_id":"e29f9e9f-cdc0-4e3f-90fe-3a0f11f45b68","year":2024},"citing_paper":{"arxiv_id":"2510.13293","last_updated":"2026-06-10T05:54:25Z","snapshot_observed_at":"2026-08-04T09:49:40.217695Z","submitted_at":"2025-10-15T08:37:16Z","title":"Cross-modal Consistency Guidance for Robust Emotion Control in Auto-Regressive TTS Models","version":3},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-05-21T20:56:37.533183Z"},"links":{"cited_paper":"/paper/2406.07803","citing_paper":"/paper/2510.13293"},"observation_digest":"sha256:16a77229f86c6e30bd157c91b8797f5135232931760ded5b3c6ef2276c8aa025","observation_id":"6b259e43-f8dc-42ff-ba5b-6554fd396522","resolution":{"observed_at":"2026-05-21T21:00:39.116646Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2406.07803","last_updated":"2024-11-04T21:39:21Z","snapshot_observed_at":"2026-07-06T18:29:17.280082Z","submitted_at":"2024-06-12T01:40:29Z","title":"EmoSphere-TTS: Emotional Style and Intensity Modeling via Spherical Emotion Vector for Controllable Emotional Text-to-Speech","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2406.07803","snapshot_observed_at":"2026-08-04T09:49:42.370460Z","title":"Emosphere-tts: Emo- tional style and intensity modeling via spherical emotion vec- tor for controllable emotional text-to-speech,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2510.13293","last_updated":"2026-06-10T05:54:25Z","snapshot_observed_at":"2026-08-04T09:49:40.217695Z","submitted_at":"2025-10-15T08:37:16Z","title":"Cross-modal Consistency Guidance for Robust Emotion Control in Auto-Regressive TTS Models","version":4},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-04T09:49:42.370460Z"},"links":{"cited_paper":"/paper/2406.07803","citing_paper":"/paper/2510.13293"},"observation_digest":"sha256:02d1ec73a8d1b939d5b8c3f71f79833f5719d6cd09db1ce05205afdd11ce36ee","observation_id":"0b8b582a-f15c-4ca8-a694-a30461ad7f50","resolution":{"observed_at":"2026-08-04T09:49:42.370460Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2406.07803","last_updated":"2024-11-04T21:39:21Z","snapshot_observed_at":"2026-07-06T18:29:17.280082Z","submitted_at":"2024-06-12T01:40:29Z","title":"EmoSphere-TTS: Emotional Style and Intensity Modeling via Spherical Emotion Vector for Controllable Emotional Text-to-Speech","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2406.07803","snapshot_observed_at":"2026-08-03T05:07:20.770726Z","title":"URL https: //aclanthology.org/2025.acl-long.313/","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2602.03420","last_updated":"2026-06-16T12:40:26Z","snapshot_observed_at":"2026-08-06T09:31:40.795834Z","submitted_at":"2026-02-03T11:45:00Z","title":"CoCoEmo: Composable and Controllable Human-Like Emotional TTS via Activation Steering","version":2},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-03T05:07:20.770726Z"},"links":{"cited_paper":"/paper/2406.07803","citing_paper":"/paper/2602.03420"},"observation_digest":"sha256:6bcd20edbaeabdcf61b31eb20678511b0c5009e0ae03c8a9f2ca5909028a60c0","observation_id":"c680dc23-065d-4932-9caf-bcb31db5d5c4","resolution":{"observed_at":"2026-08-03T05:07:20.770726Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2406.07803","last_updated":"2024-11-04T21:39:21Z","snapshot_observed_at":"2026-07-06T18:29:17.280082Z","submitted_at":"2024-06-12T01:40:29Z","title":"EmoSphere-TTS: Emotional Style and Intensity Modeling via Spherical Emotion Vector for Controllable Emotional Text-to-Speech","version":2},"cited_work":{"arxiv_id":"2406.07803","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2406.07803","snapshot_observed_at":"2026-07-03T16:08:37.822741Z","title":"Emosphere-tts: Emo- tional style and intensity modeling via spherical emotion vec- tor for controllable emotional text-to-speech","venue":null,"work_id":"e29f9e9f-cdc0-4e3f-90fe-3a0f11f45b68","year":2024},"citing_paper":{"arxiv_id":"2606.13006","last_updated":"2026-06-11T07:42:38Z","snapshot_observed_at":"2026-08-05T05:54:49.499804Z","submitted_at":"2026-06-11T07:42:38Z","title":"Emo-LiPO: Listwise Preference Optimization for Fine-Grained Emotion Intensity Control in LLM-based Text-to-Speech","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-06-27T06:01:06.123832Z"},"links":{"cited_paper":"/paper/2406.07803","citing_paper":"/paper/2606.13006"},"observation_digest":"sha256:9bac1525d42ff5207dc666f6fb153e5ec60beb9ba495e83560e0ab66833e2cf2","observation_id":"a0602683-3f44-4ad9-bf99-daf45befde38","resolution":{"observed_at":"2026-07-03T16:08:37.824383Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2406.07803","last_updated":"2024-11-04T21:39:21Z","snapshot_observed_at":"2026-07-06T18:29:17.280082Z","submitted_at":"2024-06-12T01:40:29Z","title":"EmoSphere-TTS: Emotional Style and Intensity Modeling via Spherical Emotion Vector for Controllable Emotional Text-to-Speech","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2406.07803","snapshot_observed_at":"2026-08-06T00:40:31.981929Z","title":"Emosphere-tts: Emotional style and intensity modeling via spherical emotion vector for controllable emotional text-to- speech,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2608.00998","last_updated":"2026-08-02T04:54:12Z","snapshot_observed_at":"2026-08-09T16:27:06.444887Z","submitted_at":"2026-08-02T04:54:12Z","title":"Beyond One-Size-Fits-All: Personalized and Culturally Adaptive Emotional TTS via Interactive Optimization of Individual Emotion Perception Spaces","version":1},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-06T00:40:31.981929Z"},"links":{"cited_paper":"/paper/2406.07803","citing_paper":"/paper/2608.00998"},"observation_digest":"sha256:0dbc6481700534711c42ff704cbf56aa493326550784ec015df0e2291aa15c78","observation_id":"65497633-8d62-4147-9814-61760154a903","resolution":{"observed_at":"2026-08-06T00:40:31.981929Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"links":{"evidence":"/evidence","html":"/paper/2406.07803/citation-record","integrity":"/paper/2406.07803/integrity","json":"/paper/2406.07803/citation-record.json","paper":"/paper/2406.07803"},"outbound":[],"paper":{"arxiv_id":"2406.07803","last_updated":"2024-11-04T21:39:21Z","latest_version":2,"primary_category":"cs.SD","snapshot_observed_at":"2026-07-06T18:29:17.280082Z","submitted_at":"2024-06-12T01:40:29Z","title":"EmoSphere-TTS: Emotional Style and Intensity Modeling via Spherical Emotion Vector for Controllable Emotional Text-to-Speech"},"reference_resolution":{"displayed":0,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":0,"verified_exact":0,"verified_fuzzy":0},"total_outbound_references":0},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"thesis":"As of 10 August 2026, this Paper Citation Record lists 0 of 0 outbound references and 6 inbound Pith citation observations for arXiv:2406.07803."}