{"as_of":"2026-08-16T23:08:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:dce5ec39eb6ed3e137bbfaf74046880eade73514c08f96bb2e61b85d81171a0f","coverage":[{"denominator":25,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":25,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-04T18:11:17.778258Z","state":"measured"},{"denominator":25,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":25,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-16T06:30:59.297886+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2509.10116/citation-record","integrity":"/paper/2509.10116/integrity","json":"/paper/2509.10116/citation-record.json","paper":"/paper/2509.10116"},"outbound":[{"citation":{"cited_paper":{"arxiv_id":"2006.13979","last_updated":"2020-12-15T23:19:19Z","snapshot_observed_at":"2026-08-13T17:50:33.934751Z","submitted_at":"2020-06-24T18:25:05Z","title":"Unsupervised Cross-lingual Representation Learning for Speech Recognition","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2006.13979","snapshot_observed_at":"2026-08-04T18:11:15.997955Z","title":"Unsupervised Cross-Lingual Representation Learning for Speech Recognition,","venue":null,"work_id":null,"year":2006},"citing_paper":{"arxiv_id":"2509.10116","last_updated":"2025-09-12T10:18:38Z","snapshot_observed_at":"2026-08-09T01:01:11.934533Z","submitted_at":"2025-09-12T10:18:38Z","title":"Prominence-aware automatic speech recognition for conversational speech","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-04T18:11:15.997955Z"},"links":{"cited_paper":"/paper/2006.13979","citing_paper":"/paper/2509.10116"},"observation_digest":"sha256:5987b5c77de7b0562ea9f111f8666f13bce5825468763eb559d23b121f2c21ed","observation_id":"28d5c376-de19-43ae-80aa-0fbd64522cbc","resolution":{"observed_at":"2026-08-04T18:11:15.997955Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T18:11:16.063751Z","title":"Materials and Methods 2.1.1","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2509.10116","last_updated":"2025-09-12T10:18:38Z","snapshot_observed_at":"2026-08-09T01:01:11.934533Z","submitted_at":"2025-09-12T10:18:38Z","title":"Prominence-aware automatic speech recognition for conversational speech","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-04T18:11:16.063751Z"},"links":{"citing_paper":"/paper/2509.10116"},"observation_digest":"sha256:525e75982eb1386d4259c966cd4b44ac55799e44070afa4077a7bbbcf610c509","observation_id":"d96c1d31-8c3b-4f38-bf1b-22039dff1699","resolution":{"observed_at":"2026-08-04T18:11:16.063751Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T18:11:16.166797Z","title":"Materials and Methods 3.1.1","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2509.10116","last_updated":"2025-09-12T10:18:38Z","snapshot_observed_at":"2026-08-09T01:01:11.934533Z","submitted_at":"2025-09-12T10:18:38Z","title":"Prominence-aware automatic speech recognition for conversational speech","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-04T18:11:16.166797Z"},"links":{"citing_paper":"/paper/2509.10116"},"observation_digest":"sha256:bfd96a9d3e03628a4165d70b49c741d8a30a07d9de45394b0e5219d9856b1077","observation_id":"308094a1-df7f-4ebc-8426-4258e4575a4b","resolution":{"observed_at":"2026-08-04T18:11:16.166797Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T18:11:16.237830Z","title":"Table 3: Concept of character-based prominence-aware ASR training","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2509.10116","last_updated":"2025-09-12T10:18:38Z","snapshot_observed_at":"2026-08-09T01:01:11.934533Z","submitted_at":"2025-09-12T10:18:38Z","title":"Prominence-aware automatic speech recognition for conversational speech","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-04T18:11:16.237830Z"},"links":{"citing_paper":"/paper/2509.10116"},"observation_digest":"sha256:3a6aae924c625cfc44306ea7c52ae87ce1da38ef7a42dfcfd5784dd24047f1ff","observation_id":"e3a41006-4476-409f-8255-1ba779f93943","resolution":{"observed_at":"2026-08-04T18:11:16.237830Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":"10.55776/p32700","metadata_source":"doi_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T18:14:06.526545Z","title":null,"venue":null,"work_id":"a923cc78-cc60-435e-8c3d-ceedd3d53a29","year":null},"citing_paper":{"arxiv_id":"2509.10116","last_updated":"2025-09-12T10:18:38Z","snapshot_observed_at":"2026-08-09T01:01:11.934533Z","submitted_at":"2025-09-12T10:18:38Z","title":"Prominence-aware automatic speech recognition for conversational speech","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-04T18:11:16.290039Z"},"links":{"citing_paper":"/paper/2509.10116"},"observation_digest":"sha256:6f7d2b3b4d97f198bb1521c45409fee66f6167dd741f1d5aa579f12e29c58036","observation_id":"4e9febed-2f0b-4d8c-b6b7-cff560251965","resolution":{"observed_at":"2026-08-04T18:14:06.601897Z","resolver_source":"doi","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T18:11:16.375193Z","title":"Great expectations - introspective vs. perc eptual prominence ratings and their acoustic correlates,","venue":null,"work_id":null,"year":2005},"citing_paper":{"arxiv_id":"2509.10116","last_updated":"2025-09-12T10:18:38Z","snapshot_observed_at":"2026-08-09T01:01:11.934533Z","submitted_at":"2025-09-12T10:18:38Z","title":"Prominence-aware automatic speech recognition for conversational speech","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-04T18:11:16.375193Z"},"links":{"citing_paper":"/paper/2509.10116"},"observation_digest":"sha256:236a9673a503c8487fd777c0574d8fe6443fce9b8ed2a31301380c8dac03bbd8","observation_id":"6d0deed7-0bf6-4b40-902d-a9ac84dce6e1","resolution":{"observed_at":"2026-08-04T18:11:16.375193Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T18:11:16.435766Z","title":"ANALOR . A tool for semi-automatic annotation of French prosodic stru cture,","venue":null,"work_id":null,"year":2008},"citing_paper":{"arxiv_id":"2509.10116","last_updated":"2025-09-12T10:18:38Z","snapshot_observed_at":"2026-08-09T01:01:11.934533Z","submitted_at":"2025-09-12T10:18:38Z","title":"Prominence-aware automatic speech recognition for conversational speech","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-04T18:11:16.435766Z"},"links":{"citing_paper":"/paper/2509.10116"},"observation_digest":"sha256:e998e7022e5ddc06b5dcc69eab6452e1d2feb3fc8577d0ecd82ccfb5af1207fc","observation_id":"273e4e96-4044-4613-88bb-3c8325bb649f","resolution":{"observed_at":"2026-08-04T18:11:16.435766Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T18:11:16.494907Z","title":"Automatic pros odic event detection using acoustic, lexical, and syntactic evi dence,","venue":null,"work_id":null,"year":2008},"citing_paper":{"arxiv_id":"2509.10116","last_updated":"2025-09-12T10:18:38Z","snapshot_observed_at":"2026-08-09T01:01:11.934533Z","submitted_at":"2025-09-12T10:18:38Z","title":"Prominence-aware automatic speech recognition for conversational speech","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-04T18:11:16.494907Z"},"links":{"citing_paper":"/paper/2509.10116"},"observation_digest":"sha256:42f749f646700ab803de959db5e813a56ce5c3b736e50034eb8575fb0d9d324e","observation_id":"8933b4b9-b74d-4004-a783-9e7912c960d5","resolution":{"observed_at":"2026-08-04T18:11:16.494907Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T18:11:16.581159Z","title":"Automat ic labelling of prosodic prominence, phrasing and disﬂuencie s in French speech by simulating the perception of na¨ ıve and exp ert listeners,","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2509.10116","last_updated":"2025-09-12T10:18:38Z","snapshot_observed_at":"2026-08-09T01:01:11.934533Z","submitted_at":"2025-09-12T10:18:38Z","title":"Prominence-aware automatic speech recognition for conversational speech","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-04T18:11:16.581159Z"},"links":{"citing_paper":"/paper/2509.10116"},"observation_digest":"sha256:74f6235e2c32c887670d91231d08ae53a34f8bce26c6e18146d8d9f0a7ccfc98","observation_id":"00659999-336c-465b-bffd-c540294688ef","resolution":{"observed_at":"2026-08-04T18:11:16.581159Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T18:11:16.658116Z","title":"Using word-level f eatures for prosodic prominence detection in conversational speec h,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2509.10116","last_updated":"2025-09-12T10:18:38Z","snapshot_observed_at":"2026-08-09T01:01:11.934533Z","submitted_at":"2025-09-12T10:18:38Z","title":"Prominence-aware automatic speech recognition for conversational speech","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-04T18:11:16.658116Z"},"links":{"citing_paper":"/paper/2509.10116"},"observation_digest":"sha256:135c52b243ec94cdc07ef9e5e2c142507e7b9e65b023be73a281667ad4212628","observation_id":"885c5367-ccc0-42bb-8fa5-028bab01a64e","resolution":{"observed_at":"2026-08-04T18:11:16.658116Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T18:11:16.706923Z","title":"A corpus of r ead and conversational Austrian German,","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2509.10116","last_updated":"2025-09-12T10:18:38Z","snapshot_observed_at":"2026-08-09T01:01:11.934533Z","submitted_at":"2025-09-12T10:18:38Z","title":"Prominence-aware automatic speech recognition for conversational speech","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-04T18:11:16.706923Z"},"links":{"citing_paper":"/paper/2509.10116"},"observation_digest":"sha256:e6a2a9eba96126aa87d493743ac23fe9be01d586811c832a06efa07a436b336c","observation_id":"933f9211-6078-4be4-9810-5a65df1c94ce","resolution":{"observed_at":"2026-08-04T18:11:16.706923Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T18:11:16.792268Z","title":"Wav2vec 2.0: A framework for self-supervised learning of speech representations,","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2509.10116","last_updated":"2025-09-12T10:18:38Z","snapshot_observed_at":"2026-08-09T01:01:11.934533Z","submitted_at":"2025-09-12T10:18:38Z","title":"Prominence-aware automatic speech recognition for conversational speech","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-04T18:11:16.792268Z"},"links":{"citing_paper":"/paper/2509.10116"},"observation_digest":"sha256:f08b1fefeed3a70cde37306a385e6e7328a9224dd815e8962c99b421c4ab51f9","observation_id":"8737e2c7-935b-439b-8fc0-3d638b737fd3","resolution":{"observed_at":"2026-08-04T18:11:16.792268Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T18:11:16.863528Z","title":"Phonemic competit ion in end-to-end ASR models,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2509.10116","last_updated":"2025-09-12T10:18:38Z","snapshot_observed_at":"2026-08-09T01:01:11.934533Z","submitted_at":"2025-09-12T10:18:38Z","title":"Prominence-aware automatic speech recognition for conversational speech","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-04T18:11:16.863528Z"},"links":{"citing_paper":"/paper/2509.10116"},"observation_digest":"sha256:706de34b00097e8dac47533e692bc6645d50414708f24f35aa6490d08d00a7e4","observation_id":"93205761-73be-4022-a3a8-2726bcf65814","resolution":{"observed_at":"2026-08-04T18:11:16.863528Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T18:11:16.933525Z","title":"The processing of s tress in end-to-end automatic speech recognition models,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2509.10116","last_updated":"2025-09-12T10:18:38Z","snapshot_observed_at":"2026-08-09T01:01:11.934533Z","submitted_at":"2025-09-12T10:18:38Z","title":"Prominence-aware automatic speech recognition for conversational speech","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-04T18:11:16.933525Z"},"links":{"citing_paper":"/paper/2509.10116"},"observation_digest":"sha256:5c80127a9da9a2daff887f1c0a8060b803b06784b52fc3ee862e4fd63ab427ee","observation_id":"92b3a8b1-aa0f-41d5-860d-703eb3d3bdea","resolution":{"observed_at":"2026-08-04T18:11:16.933525Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T18:11:17.006074Z","title":"Detection of prosodic boundaries in speech using wav2vec 2.0,","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2509.10116","last_updated":"2025-09-12T10:18:38Z","snapshot_observed_at":"2026-08-09T01:01:11.934533Z","submitted_at":"2025-09-12T10:18:38Z","title":"Prominence-aware automatic speech recognition for conversational speech","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-04T18:11:17.006074Z"},"links":{"citing_paper":"/paper/2509.10116"},"observation_digest":"sha256:e8286a1ea3868832eb2780c460ebc704f0103f442bb2de8ae024743c2f414a85","observation_id":"a277c3f8-09ea-4953-9a7f-ce11769fd8d7","resolution":{"observed_at":"2026-08-04T18:11:17.006074Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T18:11:17.070603Z","title":"Unsupervised Cross-Lingual Representation Lear ning for Speech Recognition,","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2509.10116","last_updated":"2025-09-12T10:18:38Z","snapshot_observed_at":"2026-08-09T01:01:11.934533Z","submitted_at":"2025-09-12T10:18:38Z","title":"Prominence-aware automatic speech recognition for conversational speech","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-04T18:11:17.070603Z"},"links":{"citing_paper":"/paper/2509.10116"},"observation_digest":"sha256:cbe7887ff1fe34276e390d0a7442cdeba794b5599f19e2f8248b36175e6e0688","observation_id":"d25f4b1c-ebca-4877-bbf5-f253bb49e159","resolution":{"observed_at":"2026-08-04T18:11:17.070603Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T18:11:17.128990Z","title":"What do self-supervised speech representat ions encode? An analysis of languages, varieties, speaking styl es and speakers,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2509.10116","last_updated":"2025-09-12T10:18:38Z","snapshot_observed_at":"2026-08-09T01:01:11.934533Z","submitted_at":"2025-09-12T10:18:38Z","title":"Prominence-aware automatic speech recognition for conversational speech","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-04T18:11:17.128990Z"},"links":{"citing_paper":"/paper/2509.10116"},"observation_digest":"sha256:0e12d53962f5f6081ecd044495dbbd679cedc854639933bd467c32f77883b67b","observation_id":"f82001dd-4532-4d8d-bbe5-33a02686b676","resolution":{"observed_at":"2026-08-04T18:11:17.128990Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T18:11:17.199231Z","title":"What’s so complex about conversational spee ch? prosodic prominence and speech recognition challenges,","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2509.10116","last_updated":"2025-09-12T10:18:38Z","snapshot_observed_at":"2026-08-09T01:01:11.934533Z","submitted_at":"2025-09-12T10:18:38Z","title":"Prominence-aware automatic speech recognition for conversational speech","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-04T18:11:17.199231Z"},"links":{"citing_paper":"/paper/2509.10116"},"observation_digest":"sha256:fba76b771e89c8673bd2c31ddc70fda7517bdc0a7074420d6f8ef60a3ee3b900","observation_id":"4024b342-e859-44ba-a0b0-11be9f2c5a95","resolution":{"observed_at":"2026-08-04T18:11:17.199231Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T18:11:17.301842Z","title":"GRASS: The Graz corpus of Read And Spon- taneous Speech,","venue":null,"work_id":null,"year":2014},"citing_paper":{"arxiv_id":"2509.10116","last_updated":"2025-09-12T10:18:38Z","snapshot_observed_at":"2026-08-09T01:01:11.934533Z","submitted_at":"2025-09-12T10:18:38Z","title":"Prominence-aware automatic speech recognition for conversational speech","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-04T18:11:17.301842Z"},"links":{"citing_paper":"/paper/2509.10116"},"observation_digest":"sha256:a80f4cbe20c88c1a496d5a8fe5eedcb4ebc6253b6e0d62b089c96ef8613842cc","observation_id":"7b63d54f-70ad-42af-83da-c15af39fec09","resolution":{"observed_at":"2026-08-04T18:11:17.301842Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T18:11:17.393065Z","title":"A corpus ofread and conversational Austrian German,","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2509.10116","last_updated":"2025-09-12T10:18:38Z","snapshot_observed_at":"2026-08-09T01:01:11.934533Z","submitted_at":"2025-09-12T10:18:38Z","title":"Prominence-aware automatic speech recognition for conversational speech","version":1},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-04T18:11:17.393065Z"},"links":{"citing_paper":"/paper/2509.10116"},"observation_digest":"sha256:c798f0a1c32aed4f39734eaee96eb2be640fded5744af39b1606c26863745e18","observation_id":"3ff1bd49-23ec-4c8c-a7c0-90d7d8d1a663","resolution":{"observed_at":"2026-08-04T18:11:17.393065Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":"10.7551/mitpress/10413.003.0011","metadata_source":"openalex","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"The Kiel Intonation Model – KIM,","venue":"The MIT Press eBooks","work_id":"79dfebd3-f739-4a4d-887d-b1a15289c579","year":2022},"citing_paper":{"arxiv_id":"2509.10116","last_updated":"2025-09-12T10:18:38Z","snapshot_observed_at":"2026-08-09T01:01:11.934533Z","submitted_at":"2025-09-12T10:18:38Z","title":"Prominence-aware automatic speech recognition for conversational speech","version":1},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-04T18:11:17.450054Z"},"links":{"citing_paper":"/paper/2509.10116"},"observation_digest":"sha256:c72daf4d65c9809fe8815179b9709f83b2a7cfd36a711e691c554020eaf2ec2f","observation_id":"123aa144-9dd1-49ba-a9df-c35b5f3f6f41","resolution":{"observed_at":"2026-08-04T18:14:06.505438Z","resolver_source":"doi","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T18:11:17.529695Z","title":"Con- nectionist temporal classiﬁcation: Labelling unsegmente d se- quence data with recurrent neural networks,","venue":null,"work_id":null,"year":2006},"citing_paper":{"arxiv_id":"2509.10116","last_updated":"2025-09-12T10:18:38Z","snapshot_observed_at":"2026-08-09T01:01:11.934533Z","submitted_at":"2025-09-12T10:18:38Z","title":"Prominence-aware automatic speech recognition for conversational speech","version":1},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-04T18:11:17.529695Z"},"links":{"citing_paper":"/paper/2509.10116"},"observation_digest":"sha256:e040e72c5e4f81601887bedc3b20e5826b40576a55fcc0540fb2498f6ca507d2","observation_id":"8a348ad4-9572-4d1a-a656-abeb7ac539a9","resolution":{"observed_at":"2026-08-04T18:11:17.529695Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2301.06475","last_updated":"2023-01-16T15:28:28Z","snapshot_observed_at":"2026-08-16T16:02:10.257536Z","submitted_at":"2023-01-16T15:28:28Z","title":"Using Kaldi for Automatic Speech Recognition of Conversational Austrian German","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2301.06475","snapshot_observed_at":"2026-08-04T18:11:17.615170Z","title":"Using K aldi for automatic speech recognition of conversational Austri an Ger- man,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2509.10116","last_updated":"2025-09-12T10:18:38Z","snapshot_observed_at":"2026-08-09T01:01:11.934533Z","submitted_at":"2025-09-12T10:18:38Z","title":"Prominence-aware automatic speech recognition for conversational speech","version":1},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-04T18:11:17.615170Z"},"links":{"cited_paper":"/paper/2301.06475","citing_paper":"/paper/2509.10116"},"observation_digest":"sha256:40f039d0e32ee257b9e9f994221a46ce93801f08a6c897a13ef4963546db37e6","observation_id":"9d1c5d41-ff8b-4f44-b819-b67f64260cc2","resolution":{"observed_at":"2026-08-04T18:11:17.615170Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T18:11:17.695788Z","title":"KenLM: Faster and smaller language model queries,","venue":null,"work_id":null,"year":2011},"citing_paper":{"arxiv_id":"2509.10116","last_updated":"2025-09-12T10:18:38Z","snapshot_observed_at":"2026-08-09T01:01:11.934533Z","submitted_at":"2025-09-12T10:18:38Z","title":"Prominence-aware automatic speech recognition for conversational speech","version":1},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-04T18:11:17.695788Z"},"links":{"citing_paper":"/paper/2509.10116"},"observation_digest":"sha256:7e69550058f12e17074836266c9b928e92bec2ca2fd71e4638c184605c7e4a40","observation_id":"b6328641-e2ea-47d1-9858-3f43888e5020","resolution":{"observed_at":"2026-08-04T18:11:17.695788Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T18:11:17.778258Z","title":"The impact of wo rd alignment accuracy on audio-visual word prominence detect ion,","venue":null,"work_id":null,"year":2014},"citing_paper":{"arxiv_id":"2509.10116","last_updated":"2025-09-12T10:18:38Z","snapshot_observed_at":"2026-08-09T01:01:11.934533Z","submitted_at":"2025-09-12T10:18:38Z","title":"Prominence-aware automatic speech recognition for conversational speech","version":1},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-08-04T18:11:17.778258Z"},"links":{"citing_paper":"/paper/2509.10116"},"observation_digest":"sha256:b5e4386c0d692ee4e17bbcdf11e3dc18a0b0c74038946792c81eeff80b512073","observation_id":"62d573f7-20b8-4fb8-be94-815464d72c2c","resolution":{"observed_at":"2026-08-04T18:11:17.778258Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"paper":{"arxiv_id":"2509.10116","last_updated":"2025-09-12T10:18:38Z","latest_version":1,"primary_category":"cs.CL","snapshot_observed_at":"2026-08-09T01:01:11.934533Z","submitted_at":"2025-09-12T10:18:38Z","title":"Prominence-aware automatic speech recognition for conversational speech"},"reference_resolution":{"displayed":25,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":23,"verified_exact":2,"verified_fuzzy":0},"total_outbound_references":25},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"thesis":"As of 16 August 2026, this Paper Citation Record lists 25 of 25 outbound references and 0 inbound Pith citation observations for arXiv:2509.10116."}