{"as_of":"2026-08-21T09:35:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:0b1bb3a079c5c5c75893f9113e3e634133e95d4c0006e5404e2c689289ce3f45","coverage":[{"denominator":26,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":26,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-11T04:16:51.818816Z","state":"measured"},{"denominator":26,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":26,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-21T06:32:19.484+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2608.09930/citation-record","integrity":"/paper/2608.09930/integrity","json":"/paper/2608.09930/citation-record.json","paper":"/paper/2608.09930"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T04:16:52.171313Z","title":null,"venue":null,"work_id":"c0396802-8d69-4739-85f1-942c26812c95","year":null},"citing_paper":{"arxiv_id":"2608.09930","last_updated":"2026-08-10T17:59:51Z","snapshot_observed_at":"2026-08-14T15:43:01.179338Z","submitted_at":"2026-08-10T17:59:51Z","title":"Beyond Naturalness: Probing Automated Text-To-Speech Evaluators on Linguistically Grounded Dimensions","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-11T04:16:51.739925Z"},"links":{"citing_paper":"/paper/2608.09930"},"observation_digest":"sha256:87082d7e0424513c750495108e921af681f9d844af8f10b69c105932c02b03dc","observation_id":"bb186f30-0364-4812-98a4-b79a5ea7b199","resolution":{"observed_at":"2026-08-11T04:16:52.175550Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T04:16:52.160020Z","title":null,"venue":null,"work_id":"95fac228-1131-4021-9679-7d57fd559a84","year":null},"citing_paper":{"arxiv_id":"2608.09930","last_updated":"2026-08-10T17:59:51Z","snapshot_observed_at":"2026-08-14T15:43:01.179338Z","submitted_at":"2026-08-10T17:59:51Z","title":"Beyond Naturalness: Probing Automated Text-To-Speech Evaluators on Linguistically Grounded Dimensions","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-11T04:16:51.743740Z"},"links":{"citing_paper":"/paper/2608.09930"},"observation_digest":"sha256:208adea4e01c141a5779fb32a7d368581f1759a097fe796ee5d0ed9b19eec650","observation_id":"88e8580f-1e71-4c4a-8b03-9220b5e6fb96","resolution":{"observed_at":"2026-08-11T04:16:52.163443Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T04:16:52.146414Z","title":"Do not swap schwas in fully reduced syllables (inaudible in synthesis)","venue":null,"work_id":"7463c798-ff83-4c0e-a7db-098a91306b60","year":null},"citing_paper":{"arxiv_id":"2608.09930","last_updated":"2026-08-10T17:59:51Z","snapshot_observed_at":"2026-08-14T15:43:01.179338Z","submitted_at":"2026-08-10T17:59:51Z","title":"Beyond Naturalness: Probing Automated Text-To-Speech Evaluators on Linguistically Grounded Dimensions","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-11T04:16:51.747105Z"},"links":{"citing_paper":"/paper/2608.09930"},"observation_digest":"sha256:cdb7c38265ad97c3f4c7830cc84def7bd5def833b7b689e78a74058d1041a867","observation_id":"4a24557b-3ec6-4376-9e8f-6c788628502b","resolution":{"observed_at":"2026-08-11T04:16:52.152433Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T04:16:52.136594Z","title":null,"venue":null,"work_id":"1b3a21b5-756b-4b82-949f-7e37be43869b","year":null},"citing_paper":{"arxiv_id":"2608.09930","last_updated":"2026-08-10T17:59:51Z","snapshot_observed_at":"2026-08-14T15:43:01.179338Z","submitted_at":"2026-08-10T17:59:51Z","title":"Beyond Naturalness: Probing Automated Text-To-Speech Evaluators on Linguistically Grounded Dimensions","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-11T04:16:51.750872Z"},"links":{"citing_paper":"/paper/2608.09930"},"observation_digest":"sha256:716547c84928b494cf8248534053219ff5217f9ecc90b558c81a580576645573","observation_id":"74a0388b-7443-4cbe-9692-2bbcad6746b7","resolution":{"observed_at":"2026-08-11T04:16:52.139879Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T04:16:52.125074Z","title":"Do not introduce ÉŽ, Éń, É¿, ÊŤ, length marks, or diacritics absent from the table; write ÉŽ as Éİ (stressed) or ÉŹ|Éź (unstressed)","venue":null,"work_id":"0b8f2bf0-35e2-4c07-b333-dd7a352c5b3b","year":null},"citing_paper":{"arxiv_id":"2608.09930","last_updated":"2026-08-10T17:59:51Z","snapshot_observed_at":"2026-08-14T15:43:01.179338Z","submitted_at":"2026-08-10T17:59:51Z","title":"Beyond Naturalness: Probing Automated Text-To-Speech Evaluators on Linguistically Grounded Dimensions","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-11T04:16:51.756529Z"},"links":{"citing_paper":"/paper/2608.09930"},"observation_digest":"sha256:9f8b795001a536421a837afe22c0f444bcadb884e7b1a96cf37844b069535925","observation_id":"142e7eb2-bf10-407e-be2d-b99eb8084e87","resolution":{"observed_at":"2026-08-11T04:16:52.129673Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T04:16:52.113948Z","title":"target_word","venue":null,"work_id":"abc66d88-fce1-4b53-a1e8-99b514abbe40","year":null},"citing_paper":{"arxiv_id":"2608.09930","last_updated":"2026-08-10T17:59:51Z","snapshot_observed_at":"2026-08-14T15:43:01.179338Z","submitted_at":"2026-08-10T17:59:51Z","title":"Beyond Naturalness: Probing Automated Text-To-Speech Evaluators on Linguistically Grounded Dimensions","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-11T04:16:51.762692Z"},"links":{"citing_paper":"/paper/2608.09930"},"observation_digest":"sha256:f19b2a2ec0ce48847fd429e47169fa7b35c888553a8baff896578c2ba216980b","observation_id":"d73b365b-6d00-4f4a-8269-9198e53c0951","resolution":{"observed_at":"2026-08-11T04:16:52.117591Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T04:16:51.957544Z","title":null,"venue":null,"work_id":"06cd7e7d-cec0-457f-a095-a22d92d9a4cc","year":null},"citing_paper":{"arxiv_id":"2608.09930","last_updated":"2026-08-10T17:59:51Z","snapshot_observed_at":"2026-08-14T15:43:01.179338Z","submitted_at":"2026-08-10T17:59:51Z","title":"Beyond Naturalness: Probing Automated Text-To-Speech Evaluators on Linguistically Grounded Dimensions","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-11T04:16:51.818816Z"},"links":{"citing_paper":"/paper/2608.09930"},"observation_digest":"sha256:5d185e96180e2dcb55f1b54eb8202c924e9b58e26c2356bc3aedb69a7e655aa5","observation_id":"cab3fd6b-bd3a-4aab-8e74-46048f00a9c2","resolution":{"observed_at":"2026-08-11T04:16:51.961806Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T04:16:52.103375Z","title":"If monosyllabic, return an empty versions array","venue":null,"work_id":"bcf071eb-fdf7-46ca-acec-43eebe364fdc","year":null},"citing_paper":{"arxiv_id":"2608.09930","last_updated":"2026-08-10T17:59:51Z","snapshot_observed_at":"2026-08-14T15:43:01.179338Z","submitted_at":"2026-08-10T17:59:51Z","title":"Beyond Naturalness: Probing Automated Text-To-Speech Evaluators on Linguistically Grounded Dimensions","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-11T04:16:51.766721Z"},"links":{"citing_paper":"/paper/2608.09930"},"observation_digest":"sha256:dbd6a91da90d19fee0914a6d710be892b4235dc0523ae4c299bf88589e52cdf4","observation_id":"5dcb38d4-eee1-4092-9ff9-f03364817d48","resolution":{"observed_at":"2026-08-11T04:16:52.107142Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T04:16:52.092921Z","title":"If a secondary stress exists, swapping primary and secondary is preferred","venue":null,"work_id":"4a7511c7-d0e2-4f58-b32f-7ff14d3f9619","year":null},"citing_paper":{"arxiv_id":"2608.09930","last_updated":"2026-08-10T17:59:51Z","snapshot_observed_at":"2026-08-14T15:43:01.179338Z","submitted_at":"2026-08-10T17:59:51Z","title":"Beyond Naturalness: Probing Automated Text-To-Speech Evaluators on Linguistically Grounded Dimensions","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-11T04:16:51.771107Z"},"links":{"citing_paper":"/paper/2608.09930"},"observation_digest":"sha256:6b7eabe567384c18042e61d8849741764ace5b7d031fa6be870f5eb01b9a0160","observation_id":"dec1d040-9641-4e9e-a528-e146ec2a7c24","resolution":{"observed_at":"2026-08-11T04:16:52.097038Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T04:16:52.082780Z","title":null,"venue":null,"work_id":"b6295eb1-0964-4f1f-bf17-75964fc2351f","year":null},"citing_paper":{"arxiv_id":"2608.09930","last_updated":"2026-08-10T17:59:51Z","snapshot_observed_at":"2026-08-14T15:43:01.179338Z","submitted_at":"2026-08-10T17:59:51Z","title":"Beyond Naturalness: Probing Automated Text-To-Speech Evaluators on Linguistically Grounded Dimensions","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-11T04:16:51.774853Z"},"links":{"citing_paper":"/paper/2608.09930"},"observation_digest":"sha256:723f739aa05124329fd2eee0a2ed8d0a9cb0093197992c86bd2fb9006ceda8ed","observation_id":"4cecae94-9a8d-4761-9645-8207e0d88d0d","resolution":{"observed_at":"2026-08-11T04:16:52.086521Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T04:16:52.071762Z","title":"that” as demonstrative→ function word; “that","venue":null,"work_id":"b3e009a9-7211-42ad-a463-7c3a53f7a548","year":null},"citing_paper":{"arxiv_id":"2608.09930","last_updated":"2026-08-10T17:59:51Z","snapshot_observed_at":"2026-08-14T15:43:01.179338Z","submitted_at":"2026-08-10T17:59:51Z","title":"Beyond Naturalness: Probing Automated Text-To-Speech Evaluators on Linguistically Grounded Dimensions","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-11T04:16:51.778656Z"},"links":{"citing_paper":"/paper/2608.09930"},"observation_digest":"sha256:daba6e45dc7ade6594b8a5de9dfa3ef9dda31ae90d90cb54381b5d226c4a9028","observation_id":"9f4311d6-bfdd-4ef3-95eb-679ce7e49889","resolution":{"observed_at":"2026-08-11T04:16:52.075890Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T04:16:52.060730Z","title":"Sentence-final punctuation stays outside any quoted span","venue":null,"work_id":"ec274f26-1d3e-42eb-a858-ed9de975bd35","year":null},"citing_paper":{"arxiv_id":"2608.09930","last_updated":"2026-08-10T17:59:51Z","snapshot_observed_at":"2026-08-14T15:43:01.179338Z","submitted_at":"2026-08-10T17:59:51Z","title":"Beyond Naturalness: Probing Automated Text-To-Speech Evaluators on Linguistically Grounded Dimensions","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-11T04:16:51.782453Z"},"links":{"citing_paper":"/paper/2608.09930"},"observation_digest":"sha256:7b6d9b0dea1764e11ec56574368b4c3ebd772aedcf0a9e276c5ae5f62e3a6d70","observation_id":"af4e92fa-bdbc-4904-9662-1a20ca3a8639","resolution":{"observed_at":"2026-08-11T04:16:52.064559Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T04:16:52.049530Z","title":null,"venue":null,"work_id":"68f5c6ea-f650-49b9-aa3d-4e2e8b7854d6","year":null},"citing_paper":{"arxiv_id":"2608.09930","last_updated":"2026-08-10T17:59:51Z","snapshot_observed_at":"2026-08-14T15:43:01.179338Z","submitted_at":"2026-08-10T17:59:51Z","title":"Beyond Naturalness: Probing Automated Text-To-Speech Evaluators on Linguistically Grounded Dimensions","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-11T04:16:51.786655Z"},"links":{"citing_paper":"/paper/2608.09930"},"observation_digest":"sha256:7a11e77b0a17388ae65e1e4d2b21012e420bdcfeeb2f415737fcd9fe9b1defa2","observation_id":"43cc34c8-6ea8-450a-92a5-e0afa0bd94a3","resolution":{"observed_at":"2026-08-11T04:16:52.053006Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T04:16:52.039659Z","title":"stress\" (used for folder naming). {","venue":null,"work_id":"d204d4b0-e7e8-48e3-aba9-4fb06b97f97c","year":null},"citing_paper":{"arxiv_id":"2608.09930","last_updated":"2026-08-10T17:59:51Z","snapshot_observed_at":"2026-08-14T15:43:01.179338Z","submitted_at":"2026-08-10T17:59:51Z","title":"Beyond Naturalness: Probing Automated Text-To-Speech Evaluators on Linguistically Grounded Dimensions","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-11T04:16:51.791179Z"},"links":{"citing_paper":"/paper/2608.09930"},"observation_digest":"sha256:bd1a3fd17a39fb1a4421120d17d46b8625d1164064a662172539e876c56209f7","observation_id":"c2a61eb3-ab6e-4ce5-9384-7f5933006cca","resolution":{"observed_at":"2026-08-11T04:16:52.043333Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T04:16:52.029115Z","title":null,"venue":null,"work_id":"77a1486e-af4b-4976-b829-fc754c0ac784","year":null},"citing_paper":{"arxiv_id":"2608.09930","last_updated":"2026-08-10T17:59:51Z","snapshot_observed_at":"2026-08-14T15:43:01.179338Z","submitted_at":"2026-08-10T17:59:51Z","title":"Beyond Naturalness: Probing Automated Text-To-Speech Evaluators on Linguistically Grounded Dimensions","version":1},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-11T04:16:51.795371Z"},"links":{"citing_paper":"/paper/2608.09930"},"observation_digest":"sha256:1113fa32454c49fd82fc83d11f3da1741dab26e89cd9ede5857805916c0db7f5","observation_id":"10f2a6dc-0fd0-45e3-8fa3-2f3aa5da728e","resolution":{"observed_at":"2026-08-11T04:16:52.032696Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T04:16:52.017040Z","title":"artifacts","venue":null,"work_id":"86b7775c-e436-403e-a7fd-0b89ad2beac4","year":null},"citing_paper":{"arxiv_id":"2608.09930","last_updated":"2026-08-10T17:59:51Z","snapshot_observed_at":"2026-08-14T15:43:01.179338Z","submitted_at":"2026-08-10T17:59:51Z","title":"Beyond Naturalness: Probing Automated Text-To-Speech Evaluators on Linguistically Grounded Dimensions","version":1},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-11T04:16:51.799897Z"},"links":{"citing_paper":"/paper/2608.09930"},"observation_digest":"sha256:5eaee02408caec3a179371dc6ef7779ced40948b8d39cc266f0444ece22df4b4","observation_id":"aa215347-0c6a-42dc-93b5-9c01024ca1ab","resolution":{"observed_at":"2026-08-11T04:16:52.021329Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T04:16:52.005277Z","title":null,"venue":null,"work_id":"b84f5db2-5d6c-46a4-a985-6c95f4d221ba","year":null},"citing_paper":{"arxiv_id":"2608.09930","last_updated":"2026-08-10T17:59:51Z","snapshot_observed_at":"2026-08-14T15:43:01.179338Z","submitted_at":"2026-08-10T17:59:51Z","title":"Beyond Naturalness: Probing Automated Text-To-Speech Evaluators on Linguistically Grounded Dimensions","version":1},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-11T04:16:51.803507Z"},"links":{"citing_paper":"/paper/2608.09930"},"observation_digest":"sha256:32016657d8fc7c4a9204057be285bdfa3dea8204d848ed5184921f9641c5e504","observation_id":"3d43f0af-5bd7-4450-8c92-b9afc4719606","resolution":{"observed_at":"2026-08-11T04:16:52.008965Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T04:16:51.993681Z","title":null,"venue":null,"work_id":"fc1343aa-732a-453c-8144-16e3568c6660","year":null},"citing_paper":{"arxiv_id":"2608.09930","last_updated":"2026-08-10T17:59:51Z","snapshot_observed_at":"2026-08-14T15:43:01.179338Z","submitted_at":"2026-08-10T17:59:51Z","title":"Beyond Naturalness: Probing Automated Text-To-Speech Evaluators on Linguistically Grounded Dimensions","version":1},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-11T04:16:51.807307Z"},"links":{"citing_paper":"/paper/2608.09930"},"observation_digest":"sha256:16adcb1757eb568a180ec07034417130bd6a714d528219344a7da7c35b1563c0","observation_id":"57c518d7-4cd6-47bd-82b5-6726817a77ef","resolution":{"observed_at":"2026-08-11T04:16:51.997807Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T04:16:51.980990Z","title":"Use throughout for diffuse artifacts (noise, compression, hum)","venue":null,"work_id":"cffef413-dcd3-473f-b735-e6f2a951e3f4","year":null},"citing_paper":{"arxiv_id":"2608.09930","last_updated":"2026-08-10T17:59:51Z","snapshot_observed_at":"2026-08-14T15:43:01.179338Z","submitted_at":"2026-08-10T17:59:51Z","title":"Beyond Naturalness: Probing Automated Text-To-Speech Evaluators on Linguistically Grounded Dimensions","version":1},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-11T04:16:51.811504Z"},"links":{"citing_paper":"/paper/2608.09930"},"observation_digest":"sha256:5b9ae8f17c28856b6d58ad903fe6fa26dbfdc52af766faf3296e9a07dad3bc76","observation_id":"c804f934-faf8-4c71-bf73-80b31f62a836","resolution":{"observed_at":"2026-08-11T04:16:51.985555Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T04:16:51.969198Z","title":"A sharp digital stutter interrupts the stressed vowel of ‘eclipse’, looping a tiny slice twice before the sentence continues","venue":null,"work_id":"b8ab233a-34d5-45f2-9ffe-a178bfb8bb00","year":null},"citing_paper":{"arxiv_id":"2608.09930","last_updated":"2026-08-10T17:59:51Z","snapshot_observed_at":"2026-08-14T15:43:01.179338Z","submitted_at":"2026-08-10T17:59:51Z","title":"Beyond Naturalness: Probing Automated Text-To-Speech Evaluators on Linguistically Grounded Dimensions","version":1},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-08-11T04:16:51.815084Z"},"links":{"citing_paper":"/paper/2608.09930"},"observation_digest":"sha256:8c3481821bdc3c53ad13267321c6639cb3e3988afabafb223094c3ca336350e4","observation_id":"93d0a020-8f81-4928-8dac-750c74d58636","resolution":{"observed_at":"2026-08-11T04:16:51.973233Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T04:16:52.183140Z","title":"InNIPS 2016 End-to-end Learning for Speech and Audio Processing Work- shop","venue":null,"work_id":"360cdb17-75dd-4007-8c6b-4652b7fe1635","year":2016},"citing_paper":{"arxiv_id":"2608.09930","last_updated":"2026-08-10T17:59:51Z","snapshot_observed_at":"2026-08-14T15:43:01.179338Z","submitted_at":"2026-08-10T17:59:51Z","title":"Beyond Naturalness: Probing Automated Text-To-Speech Evaluators on Linguistically Grounded Dimensions","version":1},"reference_index":2016,"source":"pdf_text","source_observed_at":"2026-08-11T04:16:51.726340Z"},"links":{"citing_paper":"/paper/2608.09930"},"observation_digest":"sha256:ebf9b111c87b9b8038726ad0c51f16d83940486af311c75da6e7956e5cd0b347","observation_id":"af1f11d7-7238-4c5d-a8ad-5e5500768f81","resolution":{"observed_at":"2026-08-11T04:16:52.187082Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T04:16:52.193858Z","title":"Journal of Speech, Language, and Hearing Research, 60(1):190–198","venue":null,"work_id":"949e42c0-277c-4d2a-ae57-f131b082db51","year":null},"citing_paper":{"arxiv_id":"2608.09930","last_updated":"2026-08-10T17:59:51Z","snapshot_observed_at":"2026-08-14T15:43:01.179338Z","submitted_at":"2026-08-10T17:59:51Z","title":"Beyond Naturalness: Probing Automated Text-To-Speech Evaluators on Linguistically Grounded Dimensions","version":1},"reference_index":2017,"source":"pdf_text","source_observed_at":"2026-08-11T04:16:51.711756Z"},"links":{"citing_paper":"/paper/2608.09930"},"observation_digest":"sha256:0752be836a8e82fc9f818fd93c83341db741051641b7da3a2b1e13a2ba21b5ee","observation_id":"fc804cfa-9478-4d6f-a2aa-da9651c2ac90","resolution":{"observed_at":"2026-08-11T04:16:52.197645Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2106.15561","last_updated":"2021-07-23T12:32:52Z","snapshot_observed_at":"2026-08-16T18:13:35.460831Z","submitted_at":"2021-06-29T16:50:51Z","title":"A Survey on Neural Speech Synthesis","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2106.15561","snapshot_observed_at":"2026-08-11T04:16:51.730328Z","title":"InICASSP 2021-2021 IEEE International Confer- ence on Acoustics, Speech and Signal Processing (ICASSP), pages 6493–6497","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2608.09930","last_updated":"2026-08-10T17:59:51Z","snapshot_observed_at":"2026-08-14T15:43:01.179338Z","submitted_at":"2026-08-10T17:59:51Z","title":"Beyond Naturalness: Probing Automated Text-To-Speech Evaluators on Linguistically Grounded Dimensions","version":1},"reference_index":2021,"source":"pdf_text","source_observed_at":"2026-08-11T04:16:51.730328Z"},"links":{"cited_paper":"/paper/2106.15561","citing_paper":"/paper/2608.09930"},"observation_digest":"sha256:f485d847467faf69359fe68ce3e5102524967852588445b3001f8eea16daf153","observation_id":"2a50e313-854d-4e6a-9786-3c456ff2992d","resolution":{"observed_at":"2026-08-11T04:16:51.730328Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T04:16:51.735107Z","title":"She will lead the group to the lead mine","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2608.09930","last_updated":"2026-08-10T17:59:51Z","snapshot_observed_at":"2026-08-14T15:43:01.179338Z","submitted_at":"2026-08-10T17:59:51Z","title":"Beyond Naturalness: Probing Automated Text-To-Speech Evaluators on Linguistically Grounded Dimensions","version":1},"reference_index":2022,"source":"pdf_text","source_observed_at":"2026-08-11T04:16:51.735107Z"},"links":{"citing_paper":"/paper/2608.09930"},"observation_digest":"sha256:eb0a8e9f1b0daed53c095a58504ea75713d990ea1cffea0f821c3f8d852aab1c","observation_id":"4b6ba261-7c75-48f4-9da5-43a62f869c33","resolution":{"observed_at":"2026-08-11T04:16:51.735107Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2601.04029","last_updated":"2026-04-20T13:53:49Z","snapshot_observed_at":"2026-07-06T22:41:01.254450Z","submitted_at":"2026-01-07T15:45:41Z","title":"SpeakerSleuth: Can Large Audio-Language Models Judge Speaker Consistency across Multi-turn Dialogues?","version":2},"cited_work":{"arxiv_id":"2601.04029","doi":null,"metadata_source":"pith","pith_arxiv_id":"2601.04029","snapshot_observed_at":"2026-08-11T04:16:51.943081Z","title":"SpeakerSleuth: Can Large Audio-Language Models Judge Speaker Consistency across Multi-turn Dialogues?","venue":"cs.CL","work_id":"d128b0f2-c12d-465a-ae67-a12bb1581ea7","year":2026},"citing_paper":{"arxiv_id":"2608.09930","last_updated":"2026-08-10T17:59:51Z","snapshot_observed_at":"2026-08-14T15:43:01.179338Z","submitted_at":"2026-08-10T17:59:51Z","title":"Beyond Naturalness: Probing Automated Text-To-Speech Evaluators on Linguistically Grounded Dimensions","version":1},"reference_index":2023,"source":"pdf_text","source_observed_at":"2026-08-11T04:16:51.717069Z"},"links":{"cited_paper":"/paper/2601.04029","citing_paper":"/paper/2608.09930"},"observation_digest":"sha256:aa522d7e5ba7cf77c125782d4eb5abdf57895ded55d845f20b4fff783ece8d5f","observation_id":"27d24f65-634f-4ad1-82b2-718fbce1351a","resolution":{"observed_at":"2026-08-11T04:16:51.949377Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2104.09494","last_updated":"2021-04-19T17:56:59Z","snapshot_observed_at":"2026-08-18T17:44:33.818307Z","submitted_at":"2021-04-19T17:56:59Z","title":"NISQA: A Deep CNN-Self-Attention Model for Multidimensional Speech Quality Prediction with Crowdsourced Datasets","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2104.09494","snapshot_observed_at":"2026-08-11T04:16:51.721966Z","title":"InPro- ceedings of the 19th Conference of the European Chapter of the Association for Computational Lin- guistics (V olume 1: Long Papers), pages 3644–3663","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2608.09930","last_updated":"2026-08-10T17:59:51Z","snapshot_observed_at":"2026-08-14T15:43:01.179338Z","submitted_at":"2026-08-10T17:59:51Z","title":"Beyond Naturalness: Probing Automated Text-To-Speech Evaluators on Linguistically Grounded Dimensions","version":1},"reference_index":2026,"source":"pdf_text","source_observed_at":"2026-08-11T04:16:51.721966Z"},"links":{"cited_paper":"/paper/2104.09494","citing_paper":"/paper/2608.09930"},"observation_digest":"sha256:4630990ccb2f5bfca3286c75fe76e6f94965c91d26925052168f3dbf541d5e97","observation_id":"19601c4e-067d-4dc4-ac06-f51e5edc8609","resolution":{"observed_at":"2026-08-11T04:16:51.721966Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"paper":{"arxiv_id":"2608.09930","last_updated":"2026-08-10T17:59:51Z","latest_version":1,"primary_category":"cs.SD","snapshot_observed_at":"2026-08-14T15:43:01.179338Z","submitted_at":"2026-08-10T17:59:51Z","title":"Beyond Naturalness: Probing Automated Text-To-Speech Evaluators on Linguistically Grounded Dimensions"},"reference_resolution":{"displayed":26,"state_counts":{"malformed_identifier":0,"metadata_mismatch":1,"parse_uncertain":0,"unresolved":12,"verified_exact":0,"verified_fuzzy":13},"total_outbound_references":26},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"thesis":"As of 21 August 2026, this Paper Citation Record lists 26 of 26 outbound references and 0 inbound Pith citation observations for arXiv:2608.09930."}