{"as_of":"2026-08-19T11:53:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:3d13de37fddc867b4f4efa565938904752aa917ff02a2903ba07f07a2b2e18e8","coverage":[{"denominator":39,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":39,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-07T14:23:40.684116Z","state":"measured"},{"denominator":41,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":41,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-19T06:32:44.657259+00:00","state":"measured"},{"denominator":2,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":2,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-07T14:23:36.674651Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"arxiv_reference","source_observed_at":"2026-05-11T11:06:05.369017Z","state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2505.19103","last_updated":"2025-05-25T11:45:08Z","snapshot_observed_at":"2026-08-14T02:04:39.180893Z","submitted_at":"2025-05-25T11:45:08Z","title":"WHISTRESS: Enriching Transcriptions with Sentence Stress Detection","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2505.19103","snapshot_observed_at":"2026-08-07T14:23:36.674651Z","title":"The linguistic formulation of stress falls into two perspectives, as described in [1]","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2505.19103","last_updated":"2025-05-25T11:45:08Z","snapshot_observed_at":"2026-08-14T02:04:39.180893Z","submitted_at":"2025-05-25T11:45:08Z","title":"WHISTRESS: Enriching Transcriptions with Sentence Stress Detection","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-07T14:23:36.674651Z"},"links":{"cited_paper":"/paper/2505.19103","citing_paper":"/paper/2505.19103"},"observation_digest":"sha256:32cd666ed0dff42d2f4416a3cd85fc8a96a01467b1109e4a7af372b4333234ee","observation_id":"21a62448-b5c9-4403-8777-fa782823e338","resolution":{"observed_at":"2026-08-07T14:23:36.674651Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2505.19103","last_updated":"2025-05-25T11:45:08Z","snapshot_observed_at":"2026-08-14T02:04:39.180893Z","submitted_at":"2025-05-25T11:45:08Z","title":"WHISTRESS: Enriching Transcriptions with Sentence Stress Detection","version":1},"cited_work":{"arxiv_id":"2505.19103","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2505.19103","snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Whistress: Enriching transcriptions with sentence stress detection","venue":null,"work_id":"f363a2c2-0520-4516-8be4-ccea97c17cd9","year":2025},"citing_paper":{"arxiv_id":"2604.10580","last_updated":"2026-04-12T10:57:00Z","snapshot_observed_at":"2026-08-15T12:45:22.317337Z","submitted_at":"2026-04-12T10:57:00Z","title":"Knowing What to Stress: A Discourse-Conditioned Text-to-Speech Benchmark","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-05-10T15:09:21.027609Z"},"links":{"cited_paper":"/paper/2505.19103","citing_paper":"/paper/2604.10580"},"observation_digest":"sha256:1d1d72886db450d83cacdd51eb213fe87e9224023751560b64aba6bc55230d38","observation_id":"550de9f9-faa1-4d9b-87a6-05b02ba7445e","resolution":{"observed_at":"2026-05-11T11:06:05.375927Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}}],"links":{"evidence":"/evidence","html":"/paper/2505.19103/citation-record","integrity":"/paper/2505.19103/integrity","json":"/paper/2505.19103/citation-record.json","paper":"/paper/2505.19103"},"outbound":[{"citation":{"cited_paper":{"arxiv_id":"2505.19103","last_updated":"2025-05-25T11:45:08Z","snapshot_observed_at":"2026-08-14T02:04:39.180893Z","submitted_at":"2025-05-25T11:45:08Z","title":"WHISTRESS: Enriching Transcriptions with Sentence Stress Detection","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2505.19103","snapshot_observed_at":"2026-08-07T14:23:36.674651Z","title":"The linguistic formulation of stress falls into two perspectives, as described in [1]","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2505.19103","last_updated":"2025-05-25T11:45:08Z","snapshot_observed_at":"2026-08-14T02:04:39.180893Z","submitted_at":"2025-05-25T11:45:08Z","title":"WHISTRESS: Enriching Transcriptions with Sentence Stress Detection","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-07T14:23:36.674651Z"},"links":{"cited_paper":"/paper/2505.19103","citing_paper":"/paper/2505.19103"},"observation_digest":"sha256:32cd666ed0dff42d2f4416a3cd85fc8a96a01467b1109e4a7af372b4333234ee","observation_id":"21a62448-b5c9-4403-8777-fa782823e338","resolution":{"observed_at":"2026-08-07T14:23:36.674651Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:23:45.570320Z","title":"Transcription Selection","venue":null,"work_id":"a21336cf-a65d-4d86-aa08-225bc577cfb3","year":null},"citing_paper":{"arxiv_id":"2505.19103","last_updated":"2025-05-25T11:45:08Z","snapshot_observed_at":"2026-08-14T02:04:39.180893Z","submitted_at":"2025-05-25T11:45:08Z","title":"WHISTRESS: Enriching Transcriptions with Sentence Stress Detection","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-07T14:23:36.701737Z"},"links":{"citing_paper":"/paper/2505.19103"},"observation_digest":"sha256:868996e6c9d7fa084ab2b5fc88020993f14c90566c642de61e1701ec64b7fe72","observation_id":"51e275c0-a76a-4a7f-993b-93af909d4207","resolution":{"observed_at":"2026-08-07T14:23:45.672539Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:23:45.408441Z","title":"Specifically, we propose generating two outputs for each input speech signal: the tran- scription and an emphasis score for each token in the transcrip- tion","venue":null,"work_id":"c6d83970-8623-454e-b97c-ab04b49486ff","year":null},"citing_paper":{"arxiv_id":"2505.19103","last_updated":"2025-05-25T11:45:08Z","snapshot_observed_at":"2026-08-14T02:04:39.180893Z","submitted_at":"2025-05-25T11:45:08Z","title":"WHISTRESS: Enriching Transcriptions with Sentence Stress Detection","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-07T14:23:36.768823Z"},"links":{"citing_paper":"/paper/2505.19103"},"observation_digest":"sha256:eff620c888b6e09ca2f6e0851fd66abac3477f2c367bfa1834239ac3ece84765","observation_id":"63de859d-a762-4877-9160-7e6110edeec0","resolution":{"observed_at":"2026-08-07T14:23:45.469743Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:23:45.210055Z","title":"Furthermore, we investigate how WHISTRESS identifies sentence stress by evaluating different layers as input for the stress detection head","venue":null,"work_id":"e9b44531-0bbe-473a-8626-d383219ffcdb","year":null},"citing_paper":{"arxiv_id":"2505.19103","last_updated":"2025-05-25T11:45:08Z","snapshot_observed_at":"2026-08-14T02:04:39.180893Z","submitted_at":"2025-05-25T11:45:08Z","title":"WHISTRESS: Enriching Transcriptions with Sentence Stress Detection","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-07T14:23:36.853578Z"},"links":{"citing_paper":"/paper/2505.19103"},"observation_digest":"sha256:0d3138bb6ad660d371653679e0c8fbb6e7ad8e52706b3c233e5c08a4d76abecc","observation_id":"e92dc028-c5ec-45b2-9774-0d5d1b4491d3","resolution":{"observed_at":"2026-08-07T14:23:45.319937Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:23:45.013434Z","title":"Our experiments across different datasets validate our model’s ability to identify stressed words accurately while also demonstrating impressive generalization capabilities","venue":null,"work_id":"801a5195-f73f-49fd-b8bf-393474b968a6","year":null},"citing_paper":{"arxiv_id":"2505.19103","last_updated":"2025-05-25T11:45:08Z","snapshot_observed_at":"2026-08-14T02:04:39.180893Z","submitted_at":"2025-05-25T11:45:08Z","title":"WHISTRESS: Enriching Transcriptions with Sentence Stress Detection","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-07T14:23:36.886331Z"},"links":{"citing_paper":"/paper/2505.19103"},"observation_digest":"sha256:63fe5e738f63ca278fb27021ad327227f4fe9b20c3238dd9839013254b9201d3","observation_id":"f69afa67-b89f-4cb0-95fb-33d80ed18231","resolution":{"observed_at":"2026-08-07T14:23:45.092323Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:23:44.630526Z","title":"We also presented a fully automated pipeline for synthetically generating training data specific for sentence stress detection","venue":null,"work_id":"04c4d103-87bf-4c1c-a431-c55629aceabb","year":null},"citing_paper":{"arxiv_id":"2505.19103","last_updated":"2025-05-25T11:45:08Z","snapshot_observed_at":"2026-08-14T02:04:39.180893Z","submitted_at":"2025-05-25T11:45:08Z","title":"WHISTRESS: Enriching Transcriptions with Sentence Stress Detection","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-07T14:23:37.152912Z"},"links":{"citing_paper":"/paper/2505.19103"},"observation_digest":"sha256:51465700b072686afc10252de242ac6705204cea84e2f3ea6b71543008ab1e1e","observation_id":"901ba4d6-dd34-4202-b17f-53741a45951e","resolution":{"observed_at":"2026-08-07T14:23:44.748893Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:23:43.273787Z","title":"Word prominence de- tection using robust yet simple prosodic features,","venue":null,"work_id":"785d9a86-88b0-4fa8-a294-f099204620fb","year":2012},"citing_paper":{"arxiv_id":"2505.19103","last_updated":"2025-05-25T11:45:08Z","snapshot_observed_at":"2026-08-14T02:04:39.180893Z","submitted_at":"2025-05-25T11:45:08Z","title":"WHISTRESS: Enriching Transcriptions with Sentence Stress Detection","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-07T14:23:38.042641Z"},"links":{"citing_paper":"/paper/2505.19103"},"observation_digest":"sha256:5fc442c5c7f97fc6dacf5eb0a706885077299218e29446124f5dd4bcc2acb14c","observation_id":"74a5a48b-00a0-41bc-b3a4-0c1e05e03748","resolution":{"observed_at":"2026-08-07T14:23:43.396303Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:23:44.431948Z","title":null,"venue":null,"work_id":"592d02c2-727b-4281-b0ab-53460c7b1ca2","year":2008},"citing_paper":{"arxiv_id":"2505.19103","last_updated":"2025-05-25T11:45:08Z","snapshot_observed_at":"2026-08-14T02:04:39.180893Z","submitted_at":"2025-05-25T11:45:08Z","title":"WHISTRESS: Enriching Transcriptions with Sentence Stress Detection","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-07T14:23:37.243692Z"},"links":{"citing_paper":"/paper/2505.19103"},"observation_digest":"sha256:470908c448463d8c3b8e42e6b68a3b69c6d768e3994c9ba9483f5003ce7f0aaf","observation_id":"5addbfe2-634c-4926-ac02-707e05329f40","resolution":{"observed_at":"2026-08-07T14:23:44.535531Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:23:44.239318Z","title":"The sound pattern of english,","venue":null,"work_id":"4f18431b-42c8-47df-9019-2e78cf78aab8","year":1968},"citing_paper":{"arxiv_id":"2505.19103","last_updated":"2025-05-25T11:45:08Z","snapshot_observed_at":"2026-08-14T02:04:39.180893Z","submitted_at":"2025-05-25T11:45:08Z","title":"WHISTRESS: Enriching Transcriptions with Sentence Stress Detection","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-07T14:23:37.372766Z"},"links":{"citing_paper":"/paper/2505.19103"},"observation_digest":"sha256:027440e61fe77a1a7444015c98a817cc3739144f27d1d423b4df6b0e49e9b0f1","observation_id":"ea0ca0be-5e65-4c93-8858-1eedb1760bef","resolution":{"observed_at":"2026-08-07T14:23:44.311776Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:23:44.041860Z","title":"Accent is predictable (if you’re a mind-reader),","venue":null,"work_id":"d774bbd4-977c-4084-872d-47ae33593ede","year":1972},"citing_paper":{"arxiv_id":"2505.19103","last_updated":"2025-05-25T11:45:08Z","snapshot_observed_at":"2026-08-14T02:04:39.180893Z","submitted_at":"2025-05-25T11:45:08Z","title":"WHISTRESS: Enriching Transcriptions with Sentence Stress Detection","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-07T14:23:37.522092Z"},"links":{"citing_paper":"/paper/2505.19103"},"observation_digest":"sha256:411c05532fc6d175cf1809cf43083f8c28e7ba24f086c26599249869bb8bd606","observation_id":"ecde4d72-1477-4526-9adc-d1aa5d61f803","resolution":{"observed_at":"2026-08-07T14:23:44.116109Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:23:43.852109Z","title":"Van Heuven,Acoustic Correlates and Perceptual Cues of Word and Sentence Stress: Theories, Methods and Data , 12 2018, pp","venue":null,"work_id":"06844ce3-ba2c-4ef4-96af-111eeed72b1f","year":2018},"citing_paper":{"arxiv_id":"2505.19103","last_updated":"2025-05-25T11:45:08Z","snapshot_observed_at":"2026-08-14T02:04:39.180893Z","submitted_at":"2025-05-25T11:45:08Z","title":"WHISTRESS: Enriching Transcriptions with Sentence Stress Detection","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-07T14:23:37.664419Z"},"links":{"citing_paper":"/paper/2505.19103"},"observation_digest":"sha256:b2ecf664eeb8f4aba61212034e2ef97a8d48f3a314d755b0bbcab2c52e5c2601","observation_id":"2805b6f3-40d7-4dd3-86dd-294f3812d619","resolution":{"observed_at":"2026-08-07T14:23:43.946288Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:23:43.664479Z","title":"Prosodic stress revisited: Reassess- ing the role of fundamental frequency,","venue":null,"work_id":"9569adf8-ea9d-4b08-9aaf-c0ac6a1c1198","year":2000},"citing_paper":{"arxiv_id":"2505.19103","last_updated":"2025-05-25T11:45:08Z","snapshot_observed_at":"2026-08-14T02:04:39.180893Z","submitted_at":"2025-05-25T11:45:08Z","title":"WHISTRESS: Enriching Transcriptions with Sentence Stress Detection","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-07T14:23:37.822016Z"},"links":{"citing_paper":"/paper/2505.19103"},"observation_digest":"sha256:f34ac85c53706c116b12f7979d73523213f353fb54bfd7771992f230045b11a8","observation_id":"c6329933-f6ef-4dec-a439-501379c4eb05","resolution":{"observed_at":"2026-08-07T14:23:43.762449Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:23:43.510227Z","title":"3pro – an unsupervised method for the automatic detection of sentence prominence in speech,","venue":null,"work_id":"1f19d208-7969-40f5-be3b-99d46c26a69e","year":2016},"citing_paper":{"arxiv_id":"2505.19103","last_updated":"2025-05-25T11:45:08Z","snapshot_observed_at":"2026-08-14T02:04:39.180893Z","submitted_at":"2025-05-25T11:45:08Z","title":"WHISTRESS: Enriching Transcriptions with Sentence Stress Detection","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-07T14:23:37.925239Z"},"links":{"citing_paper":"/paper/2505.19103"},"observation_digest":"sha256:290404aa06d011d74d3b41133c1f0109517aa3d53bb875498ec9373e0877e381","observation_id":"3e92d389-5c65-4928-b6d2-e3cdcdd23d98","resolution":{"observed_at":"2026-08-07T14:23:43.580012Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2212.04356","last_updated":"2022-12-06T18:46:04Z","snapshot_observed_at":"2026-08-16T23:32:22.645653Z","submitted_at":"2022-12-06T18:46:04Z","title":"Robust Speech Recognition via Large-Scale Weak Supervision","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2212.04356","snapshot_observed_at":"2026-08-07T14:23:38.902233Z","title":"Robust speech recognition via large- scale weak supervision,","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2505.19103","last_updated":"2025-05-25T11:45:08Z","snapshot_observed_at":"2026-08-14T02:04:39.180893Z","submitted_at":"2025-05-25T11:45:08Z","title":"WHISTRESS: Enriching Transcriptions with Sentence Stress Detection","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-07T14:23:38.902233Z"},"links":{"cited_paper":"/paper/2212.04356","citing_paper":"/paper/2505.19103"},"observation_digest":"sha256:c6e8813cfffd5f6315b9e1ac58262f44e85caf670dd47873de4e41e5ebc76798","observation_id":"eac08d46-0bd1-4f26-8de5-760e16456aaf","resolution":{"observed_at":"2026-08-07T14:23:38.902233Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:23:43.062406Z","title":"Crowdsourced and automatic speech prominence estimation,","venue":null,"work_id":"c83dacd3-8f59-498c-ba51-243e65adbca2","year":null},"citing_paper":{"arxiv_id":"2505.19103","last_updated":"2025-05-25T11:45:08Z","snapshot_observed_at":"2026-08-14T02:04:39.180893Z","submitted_at":"2025-05-25T11:45:08Z","title":"WHISTRESS: Enriching Transcriptions with Sentence Stress Detection","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-07T14:23:38.122350Z"},"links":{"citing_paper":"/paper/2505.19103"},"observation_digest":"sha256:f91cea7b49c89ad84d6cbea25f945b7b09877ccb6355c1af982267354140107a","observation_id":"66b58b61-426e-4b20-8840-814c54ae92a5","resolution":{"observed_at":"2026-08-07T14:23:43.143137Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1810.04805","last_updated":"2019-05-24T20:37:26Z","snapshot_observed_at":"2026-08-14T18:16:28.847993Z","submitted_at":"2018-10-11T00:50:01Z","title":"BERT: Pre-training of Deep Bidirectional Transformers for Language Understanding","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1810.04805","snapshot_observed_at":"2026-08-07T14:23:39.112899Z","title":"Bert: Pre-training of deep bidirectional transformers for language understanding,","venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2505.19103","last_updated":"2025-05-25T11:45:08Z","snapshot_observed_at":"2026-08-14T02:04:39.180893Z","submitted_at":"2025-05-25T11:45:08Z","title":"WHISTRESS: Enriching Transcriptions with Sentence Stress Detection","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-07T14:23:39.112899Z"},"links":{"cited_paper":"/paper/1810.04805","citing_paper":"/paper/2505.19103"},"observation_digest":"sha256:d3169c438d458a619e1dcec0887ed949c286c18695ff0c9b84509d1ee7a16f87","observation_id":"dfd2ecac-1a3b-4ad5-8176-c7793cf22480","resolution":{"observed_at":"2026-08-07T14:23:39.112899Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:23:42.862134Z","title":"Joint detection of sentence stress and phrase boundary for prosody,","venue":null,"work_id":"bdecae4a-6fbb-4b45-9fdd-a5c256974a9d","year":2020},"citing_paper":{"arxiv_id":"2505.19103","last_updated":"2025-05-25T11:45:08Z","snapshot_observed_at":"2026-08-14T02:04:39.180893Z","submitted_at":"2025-05-25T11:45:08Z","title":"WHISTRESS: Enriching Transcriptions with Sentence Stress Detection","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-07T14:23:38.447288Z"},"links":{"citing_paper":"/paper/2505.19103"},"observation_digest":"sha256:fa300968c47c4c535afc9101e7c7ef26b8745bb9a2bc558aea2f2473bc8d78c1","observation_id":"2e77e7db-8d26-490d-91a3-768eb1109b46","resolution":{"observed_at":"2026-08-07T14:23:42.946360Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:23:42.635141Z","title":"Automatic sentence stress feedback for non-native english learners,","venue":null,"work_id":"dd914bbb-4ce6-47f4-850f-7b5932bdb8b3","year":2016},"citing_paper":{"arxiv_id":"2505.19103","last_updated":"2025-05-25T11:45:08Z","snapshot_observed_at":"2026-08-14T02:04:39.180893Z","submitted_at":"2025-05-25T11:45:08Z","title":"WHISTRESS: Enriching Transcriptions with Sentence Stress Detection","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-07T14:23:38.557696Z"},"links":{"citing_paper":"/paper/2505.19103"},"observation_digest":"sha256:5a5862723dcc879d5f9c339db82b2a79bc05fe008774f12729d2135de563ed18","observation_id":"a3a3076b-796e-4041-901c-afa363503f92","resolution":{"observed_at":"2026-08-07T14:23:42.750801Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1510.01949","last_updated":"2015-10-07T14:08:13Z","snapshot_observed_at":"2026-08-15T02:26:51.657457Z","submitted_at":"2015-10-07T14:08:13Z","title":"Hierarchical Representation of Prosody for Statistical Speech Synthesis","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1510.01949","snapshot_observed_at":"2026-08-07T14:23:38.666038Z","title":"Hierarchical representa- tion of prosody for statistical speech synthesis,","venue":null,"work_id":null,"year":2015},"citing_paper":{"arxiv_id":"2505.19103","last_updated":"2025-05-25T11:45:08Z","snapshot_observed_at":"2026-08-14T02:04:39.180893Z","submitted_at":"2025-05-25T11:45:08Z","title":"WHISTRESS: Enriching Transcriptions with Sentence Stress Detection","version":1},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-07T14:23:38.666038Z"},"links":{"cited_paper":"/paper/1510.01949","citing_paper":"/paper/2505.19103"},"observation_digest":"sha256:483d1acc891aa449ace521da0ce234927e333396ad6e71617d7b0b3fc4e4fbcc","observation_id":"0eca83f2-3a12-4f5f-8179-8595d72ec23c","resolution":{"observed_at":"2026-08-07T14:23:38.666038Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2403.03522","last_updated":"2024-03-13T09:50:40Z","snapshot_observed_at":"2026-08-16T14:12:24.478905Z","submitted_at":"2024-03-06T08:03:05Z","title":"Non-verbal information in spontaneous speech -- towards a new framework of analysis","version":2},"cited_work":{"arxiv_id":"2403.03522","doi":null,"metadata_source":"pith","pith_arxiv_id":"2403.03522","snapshot_observed_at":"2026-08-07T14:23:41.092855Z","title":"Non-verbal information in spontaneous speech -- towards a new framework of analysis","venue":"cs.SD","work_id":"18f27d70-c551-4804-9473-80a30f251f21","year":2024},"citing_paper":{"arxiv_id":"2505.19103","last_updated":"2025-05-25T11:45:08Z","snapshot_observed_at":"2026-08-14T02:04:39.180893Z","submitted_at":"2025-05-25T11:45:08Z","title":"WHISTRESS: Enriching Transcriptions with Sentence Stress Detection","version":1},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-07T14:23:38.778952Z"},"links":{"cited_paper":"/paper/2403.03522","citing_paper":"/paper/2505.19103"},"observation_digest":"sha256:421b16b737b73076ed4a71e6303034fded180cb769565f87be349b5e159aa725","observation_id":"683192e3-b65f-48c6-8e91-da596e40ff3f","resolution":{"observed_at":"2026-08-07T14:23:41.170668Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2303.00747","last_updated":"2023-07-11T17:07:19Z","snapshot_observed_at":"2026-08-16T15:51:36.830951Z","submitted_at":"2023-03-01T18:59:13Z","title":"WhisperX: Time-Accurate Speech Transcription of Long-Form Audio","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2303.00747","snapshot_observed_at":"2026-08-07T14:23:39.721347Z","title":"Whisperx: Time-accurate speech transcription of long-form audio,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.19103","last_updated":"2025-05-25T11:45:08Z","snapshot_observed_at":"2026-08-14T02:04:39.180893Z","submitted_at":"2025-05-25T11:45:08Z","title":"WHISTRESS: Enriching Transcriptions with Sentence Stress Detection","version":1},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-07T14:23:39.721347Z"},"links":{"cited_paper":"/paper/2303.00747","citing_paper":"/paper/2505.19103"},"observation_digest":"sha256:e2a323b8a83ceb4134c8fbd555d49479df629a22932d69a2f77fafb7add0227e","observation_id":"bbadc6cc-0418-4328-81b7-d100b49c1b2e","resolution":{"observed_at":"2026-08-07T14:23:39.721347Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2409.16223","last_updated":"2024-10-13T23:07:33Z","snapshot_observed_at":"2026-08-16T13:15:48.029818Z","submitted_at":"2024-09-24T16:35:16Z","title":"Fine-Tuning is Fine, if Calibrated","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2409.16223","snapshot_observed_at":"2026-08-07T14:23:39.022594Z","title":"Fine-tuning is fine, if calibrated,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.19103","last_updated":"2025-05-25T11:45:08Z","snapshot_observed_at":"2026-08-14T02:04:39.180893Z","submitted_at":"2025-05-25T11:45:08Z","title":"WHISTRESS: Enriching Transcriptions with Sentence Stress Detection","version":1},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-07T14:23:39.022594Z"},"links":{"cited_paper":"/paper/2409.16223","citing_paper":"/paper/2505.19103"},"observation_digest":"sha256:5132c7a9cc169c8875ab4dc5baa9b4603b311f127098741dd006da34695bc6e5","observation_id":"39626fdb-5e17-4880-bc70-ba4fe442f876","resolution":{"observed_at":"2026-08-07T14:23:39.022594Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:23:42.218975Z","title":"An introduction to the boot- strap,","venue":null,"work_id":"275fab12-a118-4501-955e-4aeed876d14e","year":1995},"citing_paper":{"arxiv_id":"2505.19103","last_updated":"2025-05-25T11:45:08Z","snapshot_observed_at":"2026-08-14T02:04:39.180893Z","submitted_at":"2025-05-25T11:45:08Z","title":"WHISTRESS: Enriching Transcriptions with Sentence Stress Detection","version":1},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-07T14:23:39.943337Z"},"links":{"citing_paper":"/paper/2505.19103"},"observation_digest":"sha256:bf21936fb87ad4c77171910ee8092588c36031783935c5ff65581cec13d0f75e","observation_id":"ce46ad48-834e-47ce-8955-812838f22905","resolution":{"observed_at":"2026-08-07T14:23:42.326224Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2207.01718","last_updated":"2022-07-04T20:43:41Z","snapshot_observed_at":"2026-08-16T16:48:23.409431Z","submitted_at":"2022-07-04T20:43:41Z","title":"BERT, can HE predict contrastive focus? Predicting and controlling prominence in neural TTS using a language model","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2207.01718","snapshot_observed_at":"2026-08-07T14:23:39.222464Z","title":"Bert, can he predict contrastive focus? predicting and controlling prominence in neural tts using a language model,","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2505.19103","last_updated":"2025-05-25T11:45:08Z","snapshot_observed_at":"2026-08-14T02:04:39.180893Z","submitted_at":"2025-05-25T11:45:08Z","title":"WHISTRESS: Enriching Transcriptions with Sentence Stress Detection","version":1},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-08-07T14:23:39.222464Z"},"links":{"cited_paper":"/paper/2207.01718","citing_paper":"/paper/2505.19103"},"observation_digest":"sha256:368143898e535c6e398ab08dffb372ec4e519fe8008f3456501e391f5a882a01","observation_id":"384ce88e-98f1-4b36-85db-10aa5e2dbb93","resolution":{"observed_at":"2026-08-07T14:23:39.222464Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2305.07759","last_updated":"2023-05-24T23:30:43Z","snapshot_observed_at":"2026-08-19T04:05:48.812216Z","submitted_at":"2023-05-12T20:56:48Z","title":"TinyStories: How Small Can Language Models Be and Still Speak Coherent English?","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2305.07759","snapshot_observed_at":"2026-08-07T14:23:39.377350Z","title":"Tinystories: How small can language models be and still speak coherent english?","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.19103","last_updated":"2025-05-25T11:45:08Z","snapshot_observed_at":"2026-08-14T02:04:39.180893Z","submitted_at":"2025-05-25T11:45:08Z","title":"WHISTRESS: Enriching Transcriptions with Sentence Stress Detection","version":1},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-08-07T14:23:39.377350Z"},"links":{"cited_paper":"/paper/2305.07759","citing_paper":"/paper/2505.19103"},"observation_digest":"sha256:61fe2182c3db58b997b01f5568b90c70fb3405dfbbe9f2c5416f57f68450fac4","observation_id":"f2c97fbe-7d8f-4fcb-b20c-dfcc5c9ed12e","resolution":{"observed_at":"2026-08-07T14:23:39.377350Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:23:42.480745Z","title":null,"venue":null,"work_id":"0f9d7185-a0ec-4f54-9bfa-6062925a4f42","year":2009},"citing_paper":{"arxiv_id":"2505.19103","last_updated":"2025-05-25T11:45:08Z","snapshot_observed_at":"2026-08-14T02:04:39.180893Z","submitted_at":"2025-05-25T11:45:08Z","title":"WHISTRESS: Enriching Transcriptions with Sentence Stress Detection","version":1},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-08-07T14:23:39.491311Z"},"links":{"citing_paper":"/paper/2505.19103"},"observation_digest":"sha256:8aeeca37da81a8b8c1738e4fd01363ee5de86cd209831053047f83bd01bb8c99","observation_id":"18bfef31-a13d-434c-93d2-d3075fa05fce","resolution":{"observed_at":"2026-08-07T14:23:42.551972Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2410.21276","last_updated":"2024-10-25T17:43:01Z","snapshot_observed_at":"2026-08-15T14:02:47.366139Z","submitted_at":"2024-10-25T17:43:01Z","title":"GPT-4o System Card","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2410.21276","snapshot_observed_at":"2026-08-07T14:23:39.551167Z","title":"Gpt-4o system card,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.19103","last_updated":"2025-05-25T11:45:08Z","snapshot_observed_at":"2026-08-14T02:04:39.180893Z","submitted_at":"2025-05-25T11:45:08Z","title":"WHISTRESS: Enriching Transcriptions with Sentence Stress Detection","version":1},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-08-07T14:23:39.551167Z"},"links":{"cited_paper":"/paper/2410.21276","citing_paper":"/paper/2505.19103"},"observation_digest":"sha256:1e67b0fa36d1acd630ed84183b3a765ad4d3c768f997f5acb7c743ec4ad0cfd8","observation_id":"78820cb7-cd3d-41ca-97bb-730a46161998","resolution":{"observed_at":"2026-08-07T14:23:39.551167Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:23:44.831411Z","title":"Aix-MARSEC is a speech corpus containing over 5 hours of 1980s BBC radio recordings, featuring 53 speakers across dif- ferent speech styles [27]","venue":null,"work_id":"abcb7f0f-2d1e-4331-b012-69cfdb89102a","year":null},"citing_paper":{"arxiv_id":"2505.19103","last_updated":"2025-05-25T11:45:08Z","snapshot_observed_at":"2026-08-14T02:04:39.180893Z","submitted_at":"2025-05-25T11:45:08Z","title":"WHISTRESS: Enriching Transcriptions with Sentence Stress Detection","version":1},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-08-07T14:23:37.040537Z"},"links":{"citing_paper":"/paper/2505.19103"},"observation_digest":"sha256:94cc937a94ea3ca9580f021a15915e002a2b1273ef8ebdcc44d97f460192f111","observation_id":"6cf520f9-b1d7-44a7-a0f6-7120e8c1933e","resolution":{"observed_at":"2026-08-07T14:23:44.902352Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:23:39.635493Z","title":"Crema-d: Crowd-sourced emotional multimodal actors dataset,","venue":null,"work_id":null,"year":2014},"citing_paper":{"arxiv_id":"2505.19103","last_updated":"2025-05-25T11:45:08Z","snapshot_observed_at":"2026-08-14T02:04:39.180893Z","submitted_at":"2025-05-25T11:45:08Z","title":"WHISTRESS: Enriching Transcriptions with Sentence Stress Detection","version":1},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-08-07T14:23:39.635493Z"},"links":{"citing_paper":"/paper/2505.19103"},"observation_digest":"sha256:4cc2ecf7982b279de9d641395d52c4144fb9d85f7d949829bd102ac024ead826","observation_id":"386082dc-99f0-4288-b150-d56d9ff89d40","resolution":{"observed_at":"2026-08-07T14:23:39.635493Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:23:39.825123Z","title":"Random forests,","venue":null,"work_id":null,"year":2001},"citing_paper":{"arxiv_id":"2505.19103","last_updated":"2025-05-25T11:45:08Z","snapshot_observed_at":"2026-08-14T02:04:39.180893Z","submitted_at":"2025-05-25T11:45:08Z","title":"WHISTRESS: Enriching Transcriptions with Sentence Stress Detection","version":1},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-08-07T14:23:39.825123Z"},"links":{"citing_paper":"/paper/2505.19103"},"observation_digest":"sha256:a99a6fea4261c03a5dea56e46b26982a2714a982857136985279b2c9df660d22","observation_id":"d214428e-dd50-411b-b715-f6c903cc17bc","resolution":{"observed_at":"2026-08-07T14:23:39.825123Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:23:40.684116Z","title":"Montreal Forced Aligner: Trainable Text-Speech Alignment Using Kaldi,","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2505.19103","last_updated":"2025-05-25T11:45:08Z","snapshot_observed_at":"2026-08-14T02:04:39.180893Z","submitted_at":"2025-05-25T11:45:08Z","title":"WHISTRESS: Enriching Transcriptions with Sentence Stress Detection","version":1},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-08-07T14:23:40.684116Z"},"links":{"citing_paper":"/paper/2505.19103"},"observation_digest":"sha256:4783cf8bd42168f5a74ddb045ef550f5e5c5aa988ec0e3c443521ee2ae2f64e7","observation_id":"0dfa061d-dde3-4aae-940f-cacefb9f2623","resolution":{"observed_at":"2026-08-07T14:23:40.684116Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:23:40.049765Z","title":"Layer-wise analysis of a self-supervised speech representation model,","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2505.19103","last_updated":"2025-05-25T11:45:08Z","snapshot_observed_at":"2026-08-14T02:04:39.180893Z","submitted_at":"2025-05-25T11:45:08Z","title":"WHISTRESS: Enriching Transcriptions with Sentence Stress Detection","version":1},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-08-07T14:23:40.049765Z"},"links":{"citing_paper":"/paper/2505.19103"},"observation_digest":"sha256:3e99c06423133d36f873e755bef991ff7b61688417fb2d121f7c28ebe8f6c484","observation_id":"f13a982d-3aa1-4efe-b2b8-795403ea325c","resolution":{"observed_at":"2026-08-07T14:23:40.049765Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:23:40.160248Z","title":"wav2vec 2.0: A framework for self-supervised learning of speech repre- sentations,","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2505.19103","last_updated":"2025-05-25T11:45:08Z","snapshot_observed_at":"2026-08-14T02:04:39.180893Z","submitted_at":"2025-05-25T11:45:08Z","title":"WHISTRESS: Enriching Transcriptions with Sentence Stress Detection","version":1},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-08-07T14:23:40.160248Z"},"links":{"citing_paper":"/paper/2505.19103"},"observation_digest":"sha256:b7049a23336ee9c41f1dd66b2fa5b5d1a08a2a8c213bb6f83d35c7b1b62a22f7","observation_id":"52e9483b-3d3f-4ba5-95c0-041ce7975eb1","resolution":{"observed_at":"2026-08-07T14:23:40.160248Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:23:42.006227Z","title":"The aix-marsec project: an evolutive database of spoken british english,","venue":null,"work_id":"fefa5466-8a10-451b-8625-88b6ff300809","year":2004},"citing_paper":{"arxiv_id":"2505.19103","last_updated":"2025-05-25T11:45:08Z","snapshot_observed_at":"2026-08-14T02:04:39.180893Z","submitted_at":"2025-05-25T11:45:08Z","title":"WHISTRESS: Enriching Transcriptions with Sentence Stress Detection","version":1},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-08-07T14:23:40.286490Z"},"links":{"citing_paper":"/paper/2505.19103"},"observation_digest":"sha256:a3e340c2f15ea34a58bb9d8bc1c3c3627ed8d5924898f5f7bec61d2ee8dae1b6","observation_id":"bea3a025-20c8-4f8e-a454-bdc2e410d7dd","resolution":{"observed_at":"2026-08-07T14:23:42.091928Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2308.05725","last_updated":"2023-08-10T17:41:19Z","snapshot_observed_at":"2026-08-16T15:09:17.839357Z","submitted_at":"2023-08-10T17:41:19Z","title":"EXPRESSO: A Benchmark and Analysis of Discrete Expressive Speech Resynthesis","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2308.05725","snapshot_observed_at":"2026-08-07T14:23:40.366858Z","title":"Ex- presso: A benchmark and analysis of discrete expressive speech resynthesis,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.19103","last_updated":"2025-05-25T11:45:08Z","snapshot_observed_at":"2026-08-14T02:04:39.180893Z","submitted_at":"2025-05-25T11:45:08Z","title":"WHISTRESS: Enriching Transcriptions with Sentence Stress Detection","version":1},"reference_index":36,"source":"pdf_text","source_observed_at":"2026-08-07T14:23:40.366858Z"},"links":{"cited_paper":"/paper/2308.05725","citing_paper":"/paper/2505.19103"},"observation_digest":"sha256:6d5f701941ba6c9ef9f95a0c4aace3ff1cfe6cbf9c30db68c23a8016e4bd642c","observation_id":"742884e6-2cf3-47cd-8ac0-ae6d3c53620f","resolution":{"observed_at":"2026-08-07T14:23:40.366858Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2312.14069","last_updated":"2024-10-14T07:57:06Z","snapshot_observed_at":"2026-08-19T05:26:29.129854Z","submitted_at":"2023-12-21T17:47:33Z","title":"EmphAssess : a Prosodic Benchmark on Assessing Emphasis Transfer in Speech-to-Speech Models","version":2},"cited_work":{"arxiv_id":"2312.14069","doi":null,"metadata_source":"pith","pith_arxiv_id":"2312.14069","snapshot_observed_at":"2026-08-07T14:23:41.326432Z","title":"EmphAssess : a Prosodic Benchmark on Assessing Emphasis Transfer in Speech-to-Speech Models","venue":"cs.CL","work_id":"458af570-44e4-41f3-85a4-97dc427d501f","year":2023},"citing_paper":{"arxiv_id":"2505.19103","last_updated":"2025-05-25T11:45:08Z","snapshot_observed_at":"2026-08-14T02:04:39.180893Z","submitted_at":"2025-05-25T11:45:08Z","title":"WHISTRESS: Enriching Transcriptions with Sentence Stress Detection","version":1},"reference_index":37,"source":"pdf_text","source_observed_at":"2026-08-07T14:23:40.454848Z"},"links":{"cited_paper":"/paper/2312.14069","citing_paper":"/paper/2505.19103"},"observation_digest":"sha256:a5d65cb8415357eca1a645b906c68a2a1bc87f04f4b089b0135945ee0c732c3a","observation_id":"9b8de26c-a7cd-438d-9901-226fdd714156","resolution":{"observed_at":"2026-08-07T14:23:41.386154Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:23:41.809528Z","title":"Stress in modern english,","venue":null,"work_id":"034a1656-ac36-4130-a3cf-60363d05f33f","year":1952},"citing_paper":{"arxiv_id":"2505.19103","last_updated":"2025-05-25T11:45:08Z","snapshot_observed_at":"2026-08-14T02:04:39.180893Z","submitted_at":"2025-05-25T11:45:08Z","title":"WHISTRESS: Enriching Transcriptions with Sentence Stress Detection","version":1},"reference_index":38,"source":"pdf_text","source_observed_at":"2026-08-07T14:23:40.519267Z"},"links":{"citing_paper":"/paper/2505.19103"},"observation_digest":"sha256:f102d5942ce0e0b45272608a78b5b851bafccded99aa0bf6a23403661861e539","observation_id":"d58f5fdf-ec94-4c50-94ae-258935b2e920","resolution":{"observed_at":"2026-08-07T14:23:41.889334Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1508.01991","last_updated":"2015-08-09T06:32:47Z","snapshot_observed_at":"2026-08-14T22:37:11.812000Z","submitted_at":"2015-08-09T06:32:47Z","title":"Bidirectional LSTM-CRF Models for Sequence Tagging","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1508.01991","snapshot_observed_at":"2026-08-07T14:23:40.624715Z","title":"Bidirectional lstm-crf models for sequence tagging,","venue":null,"work_id":null,"year":2015},"citing_paper":{"arxiv_id":"2505.19103","last_updated":"2025-05-25T11:45:08Z","snapshot_observed_at":"2026-08-14T02:04:39.180893Z","submitted_at":"2025-05-25T11:45:08Z","title":"WHISTRESS: Enriching Transcriptions with Sentence Stress Detection","version":1},"reference_index":39,"source":"pdf_text","source_observed_at":"2026-08-07T14:23:40.624715Z"},"links":{"cited_paper":"/paper/1508.01991","citing_paper":"/paper/2505.19103"},"observation_digest":"sha256:bb7e3ad52dfc5d8a3acdb7fa45925c9b6b577a8d91e05031a23bfea0834ab3a5","observation_id":"d941f812-1a46-49de-839f-a2327f0960f2","resolution":{"observed_at":"2026-08-07T14:23:40.624715Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2310.08464","last_updated":"2023-12-22T21:55:30Z","snapshot_observed_at":"2026-08-16T14:52:38.027634Z","submitted_at":"2023-10-12T16:23:28Z","title":"Crowdsourced and Automatic Speech Prominence Estimation","version":2},"cited_work":{"arxiv_id":"2310.08464","doi":null,"metadata_source":"pith","pith_arxiv_id":"2310.08464","snapshot_observed_at":"2026-08-07T14:23:41.531806Z","title":"Crowdsourced and Automatic Speech Prominence Estimation","venue":"eess.AS","work_id":"4efc5cb8-ff24-44f6-8a3f-6c40010695f7","year":2023},"citing_paper":{"arxiv_id":"2505.19103","last_updated":"2025-05-25T11:45:08Z","snapshot_observed_at":"2026-08-14T02:04:39.180893Z","submitted_at":"2025-05-25T11:45:08Z","title":"WHISTRESS: Enriching Transcriptions with Sentence Stress Detection","version":1},"reference_index":2023,"source":"pdf_text","source_observed_at":"2026-08-07T14:23:38.217921Z"},"links":{"cited_paper":"/paper/2310.08464","citing_paper":"/paper/2505.19103"},"observation_digest":"sha256:c2bb676f4e2df8bcd581d60d35a98ac4ad798216707f52b52ed1249703352727","observation_id":"14f3b3b6-1f4d-4c6d-820d-832e19b193ee","resolution":{"observed_at":"2026-08-07T14:23:41.638797Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}}],"paper":{"arxiv_id":"2505.19103","last_updated":"2025-05-25T11:45:08Z","latest_version":1,"primary_category":"cs.CL","snapshot_observed_at":"2026-08-14T02:04:39.180893Z","submitted_at":"2025-05-25T11:45:08Z","title":"WHISTRESS: Enriching Transcriptions with Sentence Stress Detection"},"reference_resolution":{"displayed":39,"state_counts":{"malformed_identifier":0,"metadata_mismatch":1,"parse_uncertain":0,"unresolved":18,"verified_exact":2,"verified_fuzzy":18},"total_outbound_references":39},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"thesis":"As of 19 August 2026, this Paper Citation Record lists 39 of 39 outbound references and 2 inbound Pith citation observations for arXiv:2505.19103."}