{"as_of":"2026-08-09T02:22:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:8ec19ee4fa86f475ddcb62da374e44d52e00fc519cc7238ca136453e57fe60fb","coverage":[{"denominator":65,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":65,"source":"paper_references, paper_reference_links","source_observed_at":"2026-07-13T00:57:35.442569Z","state":"measured"},{"denominator":65,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":65,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-08T06:32:00.761636+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2607.09020/citation-record","integrity":"/paper/2607.09020/integrity","json":"/paper/2607.09020/citation-record.json","paper":"/paper/2607.09020"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-13T00:57:35.442569Z","title":"TIMIT acoustic-phonetic continuous speech corpus,","venue":null,"work_id":null,"year":1993},"citing_paper":{"arxiv_id":"2607.09020","last_updated":"2026-07-10T01:05:30Z","snapshot_observed_at":"2026-07-15T23:18:00.240166Z","submitted_at":"2026-07-10T01:05:30Z","title":"Phone Segmentation and Recognition through Phonological Activation Mapping","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-07-13T00:57:35.442569Z"},"links":{"citing_paper":"/paper/2607.09020"},"observation_digest":"sha256:fae7c3b4c07ffec5946fd23ee8c3a3093afeb58e7182037098303351a826e34c","observation_id":"0b2569cc-1701-45e9-9e9b-cbf5526f1a9d","resolution":{"observed_at":"2026-07-13T00:57:35.442569Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-13T00:57:35.442569Z","title":"Phonetic segmentation of the UCLA phonetics lab archive,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.09020","last_updated":"2026-07-10T01:05:30Z","snapshot_observed_at":"2026-07-15T23:18:00.240166Z","submitted_at":"2026-07-10T01:05:30Z","title":"Phone Segmentation and Recognition through Phonological Activation Mapping","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-07-13T00:57:35.442569Z"},"links":{"citing_paper":"/paper/2607.09020"},"observation_digest":"sha256:780d35b795f4f34b5dda0679d63659a4ba645f1fbab861663fb4f4ced9814b12","observation_id":"cbdf787f-d46e-471f-bcd4-a481e475216e","resolution":{"observed_at":"2026-07-13T00:57:35.442569Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-13T00:57:35.442569Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.09020","last_updated":"2026-07-10T01:05:30Z","snapshot_observed_at":"2026-07-15T23:18:00.240166Z","submitted_at":"2026-07-10T01:05:30Z","title":"Phone Segmentation and Recognition through Phonological Activation Mapping","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-07-13T00:57:35.442569Z"},"links":{"citing_paper":"/paper/2607.09020"},"observation_digest":"sha256:d5b7f2649c4bc76a2591778e7e1b223bf6c6bd56c922b56e5a8fd8576301953d","observation_id":"2682be51-89fd-4442-bfe5-e6f50dd42e6a","resolution":{"observed_at":"2026-07-13T00:57:35.442569Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-13T00:57:35.442569Z","title":"EduSpeak®: A speech recognition and pronunciation scoring toolkit for computer-aided language learning applications,","venue":null,"work_id":null,"year":2010},"citing_paper":{"arxiv_id":"2607.09020","last_updated":"2026-07-10T01:05:30Z","snapshot_observed_at":"2026-07-15T23:18:00.240166Z","submitted_at":"2026-07-10T01:05:30Z","title":"Phone Segmentation and Recognition through Phonological Activation Mapping","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-07-13T00:57:35.442569Z"},"links":{"citing_paper":"/paper/2607.09020"},"observation_digest":"sha256:cf48ff0a054452f9c48897d16ab05a5219341fc4b7071205ab664ea25c9c8c94","observation_id":"20bd48be-b8d9-4da1-9805-aae37df39e33","resolution":{"observed_at":"2026-07-13T00:57:35.442569Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-13T00:57:35.442569Z","title":"PRiSM: Benchmarking phone realization in speech models,","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2607.09020","last_updated":"2026-07-10T01:05:30Z","snapshot_observed_at":"2026-07-15T23:18:00.240166Z","submitted_at":"2026-07-10T01:05:30Z","title":"Phone Segmentation and Recognition through Phonological Activation Mapping","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-07-13T00:57:35.442569Z"},"links":{"citing_paper":"/paper/2607.09020"},"observation_digest":"sha256:dcc63c24a5cc00881178949de7d8d8cd322af63c1543bbbe614c1ddbb2ddc918","observation_id":"3cadde25-72c4-443e-88db-8c24a531a70a","resolution":{"observed_at":"2026-07-13T00:57:35.442569Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-13T00:57:35.442569Z","title":"Tusom2021: A Phonetically Transcribed Speech Dataset from an Endangered Language for Universal Phone Recognition Experiments,","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2607.09020","last_updated":"2026-07-10T01:05:30Z","snapshot_observed_at":"2026-07-15T23:18:00.240166Z","submitted_at":"2026-07-10T01:05:30Z","title":"Phone Segmentation and Recognition through Phonological Activation Mapping","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-07-13T00:57:35.442569Z"},"links":{"citing_paper":"/paper/2607.09020"},"observation_digest":"sha256:867fab3ad97d912c675bd71f239aab54217929197dc0c91c721bcaad1faaf28e","observation_id":"42c2382a-46fe-4f94-839a-29454a71b84e","resolution":{"observed_at":"2026-07-13T00:57:35.442569Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-13T00:57:35.442569Z","title":"Prosodic abx: A language-agnostic method for measuring prosodic contrast in speech representations,","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2607.09020","last_updated":"2026-07-10T01:05:30Z","snapshot_observed_at":"2026-07-15T23:18:00.240166Z","submitted_at":"2026-07-10T01:05:30Z","title":"Phone Segmentation and Recognition through Phonological Activation Mapping","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-07-13T00:57:35.442569Z"},"links":{"citing_paper":"/paper/2607.09020"},"observation_digest":"sha256:41435f28aef55c6534a005b0c0255c71b8ee35e845d27a4a597dc8d53352e630","observation_id":"ae27c8d6-4788-4354-b4a8-f2197d521e24","resolution":{"observed_at":"2026-07-13T00:57:35.442569Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2607.00418","last_updated":"2026-07-01T04:26:05Z","snapshot_observed_at":"2026-08-03T07:11:25.518697Z","submitted_at":"2026-07-01T04:26:05Z","title":"Speech Playground: An Interactive Tool for Speech Analysis and Comparison","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2607.00418","snapshot_observed_at":"2026-07-13T00:57:35.442569Z","title":"Speech playground: An interactive tool for speech analysis and comparison,","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2607.09020","last_updated":"2026-07-10T01:05:30Z","snapshot_observed_at":"2026-07-15T23:18:00.240166Z","submitted_at":"2026-07-10T01:05:30Z","title":"Phone Segmentation and Recognition through Phonological Activation Mapping","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-07-13T00:57:35.442569Z"},"links":{"cited_paper":"/paper/2607.00418","citing_paper":"/paper/2607.09020"},"observation_digest":"sha256:e8bd3ccd19228a639cb9d45fabcf5f9bf48a52e22b9b1d362366f7058568e062","observation_id":"5cd114aa-0b21-43b5-ab44-990d572a6637","resolution":{"observed_at":"2026-07-13T00:57:35.442569Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-13T00:57:35.442569Z","title":"Towards language-agnostic stipa: Universal phonetic transcription to support language documentation at scale,","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.09020","last_updated":"2026-07-10T01:05:30Z","snapshot_observed_at":"2026-07-15T23:18:00.240166Z","submitted_at":"2026-07-10T01:05:30Z","title":"Phone Segmentation and Recognition through Phonological Activation Mapping","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-07-13T00:57:35.442569Z"},"links":{"citing_paper":"/paper/2607.09020"},"observation_digest":"sha256:20e22d0bd18e1d4f7cd046eea53c76a40b0bdcc15d95894432b931c1d8f8c526","observation_id":"72c23509-da29-4dec-b46e-2f6f336583a5","resolution":{"observed_at":"2026-07-13T00:57:35.442569Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-13T00:57:35.442569Z","title":"Language documentation twenty-five years on,","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2607.09020","last_updated":"2026-07-10T01:05:30Z","snapshot_observed_at":"2026-07-15T23:18:00.240166Z","submitted_at":"2026-07-10T01:05:30Z","title":"Phone Segmentation and Recognition through Phonological Activation Mapping","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-07-13T00:57:35.442569Z"},"links":{"citing_paper":"/paper/2607.09020"},"observation_digest":"sha256:5c69dbdab5c05ef9ec9c6723751c616c786293958bd48d040a3600a1fff344f4","observation_id":"b0c425a4-f668-4b6b-bf2f-9ab3e08fb5de","resolution":{"observed_at":"2026-07-13T00:57:35.442569Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-13T00:57:35.442569Z","title":"The buckeye corpus of conversational speech: labeling conventions and a test of transcriber reliability,","venue":null,"work_id":null,"year":2005},"citing_paper":{"arxiv_id":"2607.09020","last_updated":"2026-07-10T01:05:30Z","snapshot_observed_at":"2026-07-15T23:18:00.240166Z","submitted_at":"2026-07-10T01:05:30Z","title":"Phone Segmentation and Recognition through Phonological Activation Mapping","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-07-13T00:57:35.442569Z"},"links":{"citing_paper":"/paper/2607.09020"},"observation_digest":"sha256:fe3f3a0f2653c0206aad71fed9cc88a9b12d7dc4f4a95ee394d5ebdceebcb302","observation_id":"9c50e989-3ab5-469c-8e1c-70df7aa53f53","resolution":{"observed_at":"2026-07-13T00:57:35.442569Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-13T00:57:35.442569Z","title":"Reliability studies in broad and narrow phonetic transcription,","venue":null,"work_id":null,"year":1991},"citing_paper":{"arxiv_id":"2607.09020","last_updated":"2026-07-10T01:05:30Z","snapshot_observed_at":"2026-07-15T23:18:00.240166Z","submitted_at":"2026-07-10T01:05:30Z","title":"Phone Segmentation and Recognition through Phonological Activation Mapping","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-07-13T00:57:35.442569Z"},"links":{"citing_paper":"/paper/2607.09020"},"observation_digest":"sha256:0b76133ac601408b4651e87ac031864847fda1e4935fecc08a3d00bc6ab2e394","observation_id":"b582588b-5386-4d63-a67c-630e58fde0cc","resolution":{"observed_at":"2026-07-13T00:57:35.442569Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-13T00:57:35.442569Z","title":"Simple and Effective Zero-shot Cross- lingual Phoneme Recognition,","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2607.09020","last_updated":"2026-07-10T01:05:30Z","snapshot_observed_at":"2026-07-15T23:18:00.240166Z","submitted_at":"2026-07-10T01:05:30Z","title":"Phone Segmentation and Recognition through Phonological Activation Mapping","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-07-13T00:57:35.442569Z"},"links":{"citing_paper":"/paper/2607.09020"},"observation_digest":"sha256:326ed26806ea28ef30a060fe662955036844058a00aafaed4525f8604448a016","observation_id":"3aea93c9-e3be-4ae9-9dee-48817784ad88","resolution":{"observed_at":"2026-07-13T00:57:35.442569Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-13T00:57:35.442569Z","title":"ZIPA: A family of efficient models for multilingual phone recognition,","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.09020","last_updated":"2026-07-10T01:05:30Z","snapshot_observed_at":"2026-07-15T23:18:00.240166Z","submitted_at":"2026-07-10T01:05:30Z","title":"Phone Segmentation and Recognition through Phonological Activation Mapping","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-07-13T00:57:35.442569Z"},"links":{"citing_paper":"/paper/2607.09020"},"observation_digest":"sha256:794394677eee3d3eec5b81354ad1bec461c07e4deba938699b7abefed43eef1c","observation_id":"9e7a11bd-e9a0-4904-bb0f-6a5f16967a7b","resolution":{"observed_at":"2026-07-13T00:57:35.442569Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-13T00:57:35.442569Z","title":"POWSM: A phonetic open whisper-style speech foundation model,","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2607.09020","last_updated":"2026-07-10T01:05:30Z","snapshot_observed_at":"2026-07-15T23:18:00.240166Z","submitted_at":"2026-07-10T01:05:30Z","title":"Phone Segmentation and Recognition through Phonological Activation Mapping","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-07-13T00:57:35.442569Z"},"links":{"citing_paper":"/paper/2607.09020"},"observation_digest":"sha256:0d824f1a9b6c06a8d575341dc5e6dd718c635c324a7be56f552732c96b86b020","observation_id":"d896be05-28c5-4b51-842c-ac7f1cdb01c3","resolution":{"observed_at":"2026-07-13T00:57:35.442569Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-13T00:57:35.442569Z","title":"An Empirical Recipe for Universal Phone Recognition,","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2607.09020","last_updated":"2026-07-10T01:05:30Z","snapshot_observed_at":"2026-07-15T23:18:00.240166Z","submitted_at":"2026-07-10T01:05:30Z","title":"Phone Segmentation and Recognition through Phonological Activation Mapping","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-07-13T00:57:35.442569Z"},"links":{"citing_paper":"/paper/2607.09020"},"observation_digest":"sha256:c5a3aa375f9ff6dd17268131ccd35db803b48c09a45f7d2f97ad7da683ccd7e9","observation_id":"8f382439-53b3-46a0-a037-905bf6188a5d","resolution":{"observed_at":"2026-07-13T00:57:35.442569Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-13T00:57:35.442569Z","title":"Connectionist temporal classification: labelling unsegmented sequence data with recurrent neural networks,","venue":null,"work_id":null,"year":2006},"citing_paper":{"arxiv_id":"2607.09020","last_updated":"2026-07-10T01:05:30Z","snapshot_observed_at":"2026-07-15T23:18:00.240166Z","submitted_at":"2026-07-10T01:05:30Z","title":"Phone Segmentation and Recognition through Phonological Activation Mapping","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-07-13T00:57:35.442569Z"},"links":{"citing_paper":"/paper/2607.09020"},"observation_digest":"sha256:b20ae48d743e6d188d01f46da25883b89f687fe4f9dc1954db34e656aaf83249","observation_id":"e0fcbc95-6206-4bcb-8d9a-3a76479ff1d1","resolution":{"observed_at":"2026-07-13T00:57:35.442569Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-13T00:57:35.442569Z","title":"Attention is all you need,","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2607.09020","last_updated":"2026-07-10T01:05:30Z","snapshot_observed_at":"2026-07-15T23:18:00.240166Z","submitted_at":"2026-07-10T01:05:30Z","title":"Phone Segmentation and Recognition through Phonological Activation Mapping","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-07-13T00:57:35.442569Z"},"links":{"citing_paper":"/paper/2607.09020"},"observation_digest":"sha256:4fe30c629e74a90c75b24527c9a61aad117566968e0125f84b6a22fa504df4d4","observation_id":"d71d8d26-c0a9-44ad-b5e7-95ab3b6ba834","resolution":{"observed_at":"2026-07-13T00:57:35.442569Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-13T00:57:35.442569Z","title":"Attention-based models for speech recognition,","venue":null,"work_id":null,"year":2015},"citing_paper":{"arxiv_id":"2607.09020","last_updated":"2026-07-10T01:05:30Z","snapshot_observed_at":"2026-07-15T23:18:00.240166Z","submitted_at":"2026-07-10T01:05:30Z","title":"Phone Segmentation and Recognition through Phonological Activation Mapping","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-07-13T00:57:35.442569Z"},"links":{"citing_paper":"/paper/2607.09020"},"observation_digest":"sha256:089ea619f44f4d348c4bda4c2ed95ce41d001c9228b1b714524a6750ac86a481","observation_id":"6e02882f-f6c6-4c59-be0e-420d9434effe","resolution":{"observed_at":"2026-07-13T00:57:35.442569Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-13T00:57:35.442569Z","title":"Phoneme Segmentation Using Self-Supervised Speech Models,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2607.09020","last_updated":"2026-07-10T01:05:30Z","snapshot_observed_at":"2026-07-15T23:18:00.240166Z","submitted_at":"2026-07-10T01:05:30Z","title":"Phone Segmentation and Recognition through Phonological Activation Mapping","version":1},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-07-13T00:57:35.442569Z"},"links":{"citing_paper":"/paper/2607.09020"},"observation_digest":"sha256:c762cb166917c485a42973f42835e1de51414c4d1d36b52c7ff50d4880a2d810","observation_id":"366d6377-5d3c-40e7-beda-79e4da88ef33","resolution":{"observed_at":"2026-07-13T00:57:35.442569Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-13T00:57:35.442569Z","title":"Phone-to-audio alignment without text: A semi-supervised approach,","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2607.09020","last_updated":"2026-07-10T01:05:30Z","snapshot_observed_at":"2026-07-15T23:18:00.240166Z","submitted_at":"2026-07-10T01:05:30Z","title":"Phone Segmentation and Recognition through Phonological Activation Mapping","version":1},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-07-13T00:57:35.442569Z"},"links":{"citing_paper":"/paper/2607.09020"},"observation_digest":"sha256:d55877e7b36b8167254b312e46dc893f9f674b0174492ae20e64bf378cf80b2d","observation_id":"24a42d0f-faa9-4286-87f4-b34286fb4421","resolution":{"observed_at":"2026-07-13T00:57:35.442569Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-13T00:57:35.442569Z","title":"Explore wav2vec 2.0 for mispronunciation detection","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2607.09020","last_updated":"2026-07-10T01:05:30Z","snapshot_observed_at":"2026-07-15T23:18:00.240166Z","submitted_at":"2026-07-10T01:05:30Z","title":"Phone Segmentation and Recognition through Phonological Activation Mapping","version":1},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-07-13T00:57:35.442569Z"},"links":{"citing_paper":"/paper/2607.09020"},"observation_digest":"sha256:fdc3c0b94860a37bc5fcda477b435ea0be8aa054dc6423efb714cefc4c7cc264","observation_id":"291a6fa1-4aff-434f-88c4-0f4c1adb336c","resolution":{"observed_at":"2026-07-13T00:57:35.442569Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-13T00:57:35.442569Z","title":"Speech intelligibility assessment of dysarthric speech by using goodness of pronunciation with uncertainty quantification,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2607.09020","last_updated":"2026-07-10T01:05:30Z","snapshot_observed_at":"2026-07-15T23:18:00.240166Z","submitted_at":"2026-07-10T01:05:30Z","title":"Phone Segmentation and Recognition through Phonological Activation Mapping","version":1},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-07-13T00:57:35.442569Z"},"links":{"citing_paper":"/paper/2607.09020"},"observation_digest":"sha256:fbb7fb9f409d5cdbe1532c89da480855f0fcaeebf10fb432038672a835bfe4f6","observation_id":"7ace7755-68d9-481e-b5b6-6f2ec5f77765","resolution":{"observed_at":"2026-07-13T00:57:35.442569Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-13T00:57:35.442569Z","title":"wav2vec 2.0: A framework for self-supervised learning of speech representations,","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2607.09020","last_updated":"2026-07-10T01:05:30Z","snapshot_observed_at":"2026-07-15T23:18:00.240166Z","submitted_at":"2026-07-10T01:05:30Z","title":"Phone Segmentation and Recognition through Phonological Activation Mapping","version":1},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-07-13T00:57:35.442569Z"},"links":{"citing_paper":"/paper/2607.09020"},"observation_digest":"sha256:c8f79b8ebd4ae907d9558e5989ef977729735f5d445942ceaddadf3b500d11f4","observation_id":"e62587dc-5889-4549-a380-1144facb1037","resolution":{"observed_at":"2026-07-13T00:57:35.442569Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-13T00:57:35.442569Z","title":"HuBERT: Self-supervised speech representation learning by masked prediction of hidden units,","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2607.09020","last_updated":"2026-07-10T01:05:30Z","snapshot_observed_at":"2026-07-15T23:18:00.240166Z","submitted_at":"2026-07-10T01:05:30Z","title":"Phone Segmentation and Recognition through Phonological Activation Mapping","version":1},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-07-13T00:57:35.442569Z"},"links":{"citing_paper":"/paper/2607.09020"},"observation_digest":"sha256:a20cc7215c12fb1479a99e89e32e9059b983fb5672f721965140b5ea091851c2","observation_id":"247b429c-17fe-4e84-9bb9-05f82370812c","resolution":{"observed_at":"2026-07-13T00:57:35.442569Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-13T00:57:35.442569Z","title":"WavLM: Large-scale self-supervised pre- training for full stack speech processing,","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2607.09020","last_updated":"2026-07-10T01:05:30Z","snapshot_observed_at":"2026-07-15T23:18:00.240166Z","submitted_at":"2026-07-10T01:05:30Z","title":"Phone Segmentation and Recognition through Phonological Activation Mapping","version":1},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-07-13T00:57:35.442569Z"},"links":{"citing_paper":"/paper/2607.09020"},"observation_digest":"sha256:fbe3eb9d2249c9c0d8edac94506008faec6c9ed36d722c965d6c342c7228ca77","observation_id":"8a3f6c9f-9a57-49bf-ab01-1a46e9af62b8","resolution":{"observed_at":"2026-07-13T00:57:35.442569Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-13T00:57:35.442569Z","title":"[b]=[d]- [t]+[p]: Self-supervised speech models discover phonological vector arithmetic,","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2607.09020","last_updated":"2026-07-10T01:05:30Z","snapshot_observed_at":"2026-07-15T23:18:00.240166Z","submitted_at":"2026-07-10T01:05:30Z","title":"Phone Segmentation and Recognition through Phonological Activation Mapping","version":1},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-07-13T00:57:35.442569Z"},"links":{"citing_paper":"/paper/2607.09020"},"observation_digest":"sha256:72075d061d30fecb030c23a512a161e594d9621f13e0c13c328eca9d4a348e53","observation_id":"3edab171-99dc-45a4-9c0e-c8653b174df3","resolution":{"observed_at":"2026-07-13T00:57:35.442569Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-13T00:57:35.442569Z","title":"Self- supervised speech models encode phonetic context via position-dependent orthogonal subspaces,","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2607.09020","last_updated":"2026-07-10T01:05:30Z","snapshot_observed_at":"2026-07-15T23:18:00.240166Z","submitted_at":"2026-07-10T01:05:30Z","title":"Phone Segmentation and Recognition through Phonological Activation Mapping","version":1},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-07-13T00:57:35.442569Z"},"links":{"citing_paper":"/paper/2607.09020"},"observation_digest":"sha256:3d4d2eb092d67f7fd37115d5acf6f37d3b5a816c48669058766869bec5ffa41d","observation_id":"72aaabfd-4aed-4361-a018-2d4c890e0663","resolution":{"observed_at":"2026-07-13T00:57:35.442569Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2210.15386","last_updated":"2022-10-27T12:47:35Z","snapshot_observed_at":"2026-08-07T03:34:40.754359Z","submitted_at":"2022-10-27T12:47:35Z","title":"Opening the Black Box of wav2vec Feature Encoder","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2210.15386","snapshot_observed_at":"2026-07-13T00:57:35.442569Z","title":"Opening the black box of wav2vec feature encoder,","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2607.09020","last_updated":"2026-07-10T01:05:30Z","snapshot_observed_at":"2026-07-15T23:18:00.240166Z","submitted_at":"2026-07-10T01:05:30Z","title":"Phone Segmentation and Recognition through Phonological Activation Mapping","version":1},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-07-13T00:57:35.442569Z"},"links":{"cited_paper":"/paper/2210.15386","citing_paper":"/paper/2607.09020"},"observation_digest":"sha256:e31d8e177b8ea734194043902a9648c055c66e853490a256c0f9b0f8045fcee7","observation_id":"c2096f22-434b-483e-ac0e-38f0ced3079d","resolution":{"observed_at":"2026-07-13T00:57:35.442569Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-13T00:57:35.442569Z","title":"Analysing discrete self supervised speech representation for spoken language modeling,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2607.09020","last_updated":"2026-07-10T01:05:30Z","snapshot_observed_at":"2026-07-15T23:18:00.240166Z","submitted_at":"2026-07-10T01:05:30Z","title":"Phone Segmentation and Recognition through Phonological Activation Mapping","version":1},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-07-13T00:57:35.442569Z"},"links":{"citing_paper":"/paper/2607.09020"},"observation_digest":"sha256:15058b314a30b8e76057ad3abd0f75b39ff4559516397ad64e467d90a0be1259","observation_id":"cda3997d-79e2-4ad0-a069-e7009c84dfbb","resolution":{"observed_at":"2026-07-13T00:57:35.442569Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-13T00:57:35.442569Z","title":"Leveraging allophony in self-supervised speech models for atypical pronunciation assessment,","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.09020","last_updated":"2026-07-10T01:05:30Z","snapshot_observed_at":"2026-07-15T23:18:00.240166Z","submitted_at":"2026-07-10T01:05:30Z","title":"Phone Segmentation and Recognition through Phonological Activation Mapping","version":1},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-07-13T00:57:35.442569Z"},"links":{"citing_paper":"/paper/2607.09020"},"observation_digest":"sha256:74f0d17e01a95b1f130f33802077afbdec2c43ae25d8355c05967d16363a3bc6","observation_id":"7115bc31-bec1-4eb0-baec-057d7f1ae2fc","resolution":{"observed_at":"2026-07-13T00:57:35.442569Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-13T00:57:35.442569Z","title":"Layer-wise analysis of a self- supervised speech representation model,","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2607.09020","last_updated":"2026-07-10T01:05:30Z","snapshot_observed_at":"2026-07-15T23:18:00.240166Z","submitted_at":"2026-07-10T01:05:30Z","title":"Phone Segmentation and Recognition through Phonological Activation Mapping","version":1},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-07-13T00:57:35.442569Z"},"links":{"citing_paper":"/paper/2607.09020"},"observation_digest":"sha256:023cb06a212e2c551a5de4004578fcd72e9050fd31a772666c72658a5aac8b76","observation_id":"c9db6dda-5733-4661-a53c-67ac1b1393e0","resolution":{"observed_at":"2026-07-13T00:57:35.442569Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2508.12255","last_updated":"2025-08-17T06:31:34Z","snapshot_observed_at":"2026-08-06T19:08:14.490164Z","submitted_at":"2025-08-17T06:31:34Z","title":"What do Speech Foundation Models Learn? Analysis and Applications","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2508.12255","snapshot_observed_at":"2026-07-13T00:57:35.442569Z","title":"What do Speech Foundation Models Learn? Analysis and Applications,","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.09020","last_updated":"2026-07-10T01:05:30Z","snapshot_observed_at":"2026-07-15T23:18:00.240166Z","submitted_at":"2026-07-10T01:05:30Z","title":"Phone Segmentation and Recognition through Phonological Activation Mapping","version":1},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-07-13T00:57:35.442569Z"},"links":{"cited_paper":"/paper/2508.12255","citing_paper":"/paper/2607.09020"},"observation_digest":"sha256:66bce3eab1fb02c208266a8aecd84f73bc09ff74d20781adfbf2f80a051c8e89","observation_id":"69a49c40-034a-4d1a-a84e-d2211ae6b573","resolution":{"observed_at":"2026-07-13T00:57:35.442569Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-13T00:57:35.442569Z","title":"Panphon: A resource for mapping ipa segments to articulatory feature vectors,","venue":null,"work_id":null,"year":2016},"citing_paper":{"arxiv_id":"2607.09020","last_updated":"2026-07-10T01:05:30Z","snapshot_observed_at":"2026-07-15T23:18:00.240166Z","submitted_at":"2026-07-10T01:05:30Z","title":"Phone Segmentation and Recognition through Phonological Activation Mapping","version":1},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-07-13T00:57:35.442569Z"},"links":{"citing_paper":"/paper/2607.09020"},"observation_digest":"sha256:9cac0c0a6f9336c8a5ee891230a7ca723ad7b903b3fef2713af4d7f0d87c11e2","observation_id":"5e84c68d-d62d-427b-9152-8f6cf4f17737","resolution":{"observed_at":"2026-07-13T00:57:35.442569Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-13T00:57:35.442569Z","title":"Multi-level acoustic segmentation of continuous speech,","venue":null,"work_id":null,"year":1988},"citing_paper":{"arxiv_id":"2607.09020","last_updated":"2026-07-10T01:05:30Z","snapshot_observed_at":"2026-07-15T23:18:00.240166Z","submitted_at":"2026-07-10T01:05:30Z","title":"Phone Segmentation and Recognition through Phonological Activation Mapping","version":1},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-07-13T00:57:35.442569Z"},"links":{"citing_paper":"/paper/2607.09020"},"observation_digest":"sha256:f91acdac7aad8e116199c1a6ddbc4cfcd4ca96b03eb5082c3315e2ccf20edeb4","observation_id":"1bb34012-b65d-450e-9516-b48b3cd8d28b","resolution":{"observed_at":"2026-07-13T00:57:35.442569Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-13T00:57:35.442569Z","title":"Segmentation and modeling in segment- based recognition,","venue":null,"work_id":null,"year":1997},"citing_paper":{"arxiv_id":"2607.09020","last_updated":"2026-07-10T01:05:30Z","snapshot_observed_at":"2026-07-15T23:18:00.240166Z","submitted_at":"2026-07-10T01:05:30Z","title":"Phone Segmentation and Recognition through Phonological Activation Mapping","version":1},"reference_index":36,"source":"pdf_text","source_observed_at":"2026-07-13T00:57:35.442569Z"},"links":{"citing_paper":"/paper/2607.09020"},"observation_digest":"sha256:ec09b5ee3c109db5a8af5d20a1a4337b2a0d76602416e59ccbd8eff03a9517a5","observation_id":"f858bf78-081d-4041-a8b0-444c7371d6e8","resolution":{"observed_at":"2026-07-13T00:57:35.442569Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-13T00:57:35.442569Z","title":"Self-Supervised Contrastive Learning for Unsupervised Phoneme Segmentation,","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2607.09020","last_updated":"2026-07-10T01:05:30Z","snapshot_observed_at":"2026-07-15T23:18:00.240166Z","submitted_at":"2026-07-10T01:05:30Z","title":"Phone Segmentation and Recognition through Phonological Activation Mapping","version":1},"reference_index":37,"source":"pdf_text","source_observed_at":"2026-07-13T00:57:35.442569Z"},"links":{"citing_paper":"/paper/2607.09020"},"observation_digest":"sha256:94b8a2eb2e9b48eddf844636e514e844e8590447c50dd6e8891cd8e43480dc86","observation_id":"84aeab93-7341-4799-bca9-c3e22176971a","resolution":{"observed_at":"2026-07-13T00:57:35.442569Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-13T00:57:35.442569Z","title":"A simple hmm with self-supervised represen- tations for phone segmentation,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.09020","last_updated":"2026-07-10T01:05:30Z","snapshot_observed_at":"2026-07-15T23:18:00.240166Z","submitted_at":"2026-07-10T01:05:30Z","title":"Phone Segmentation and Recognition through Phonological Activation Mapping","version":1},"reference_index":38,"source":"pdf_text","source_observed_at":"2026-07-13T00:57:35.442569Z"},"links":{"citing_paper":"/paper/2607.09020"},"observation_digest":"sha256:9c7269feb7abff32c1d0a457c9a01c3b2bb24c3efa7b9965846eee2175b8f8a8","observation_id":"bb3a14a2-ac85-40c5-bee4-bf597568ca3b","resolution":{"observed_at":"2026-07-13T00:57:35.442569Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-13T00:57:35.442569Z","title":"Unsupervised Speech Segmentation and Variable Rate Representation Learning Using Segmental Contrastive Predictive Coding,","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2607.09020","last_updated":"2026-07-10T01:05:30Z","snapshot_observed_at":"2026-07-15T23:18:00.240166Z","submitted_at":"2026-07-10T01:05:30Z","title":"Phone Segmentation and Recognition through Phonological Activation Mapping","version":1},"reference_index":39,"source":"pdf_text","source_observed_at":"2026-07-13T00:57:35.442569Z"},"links":{"citing_paper":"/paper/2607.09020"},"observation_digest":"sha256:bd81b1332b54de3a52c097ce4e326622897d6f327f49e61654103c1ba6d5ddaa","observation_id":"a49084cc-7f62-4fea-a81a-02eab721a34b","resolution":{"observed_at":"2026-07-13T00:57:35.442569Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-13T00:57:35.442569Z","title":"Universal phone recognition with a multilingual allophone system,","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2607.09020","last_updated":"2026-07-10T01:05:30Z","snapshot_observed_at":"2026-07-15T23:18:00.240166Z","submitted_at":"2026-07-10T01:05:30Z","title":"Phone Segmentation and Recognition through Phonological Activation Mapping","version":1},"reference_index":40,"source":"pdf_text","source_observed_at":"2026-07-13T00:57:35.442569Z"},"links":{"citing_paper":"/paper/2607.09020"},"observation_digest":"sha256:38ab332f2454c1a11091db31616b4e8c7eaaae3694f1c6b49a5b7a9e71c6b24a","observation_id":"2f51eb97-9548-470b-b473-df654e632fa5","resolution":{"observed_at":"2026-07-13T00:57:35.442569Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-13T00:57:35.442569Z","title":"Allophant: Cross-lingual Phoneme Recognition with Articulatory Attributes,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2607.09020","last_updated":"2026-07-10T01:05:30Z","snapshot_observed_at":"2026-07-15T23:18:00.240166Z","submitted_at":"2026-07-10T01:05:30Z","title":"Phone Segmentation and Recognition through Phonological Activation Mapping","version":1},"reference_index":41,"source":"pdf_text","source_observed_at":"2026-07-13T00:57:35.442569Z"},"links":{"citing_paper":"/paper/2607.09020"},"observation_digest":"sha256:d7333637408dc278492e466f0d1e2401a87e54fcb36933229053c8eebef033e9","observation_id":"83317e2f-1840-4159-aaab-38a152d0f89f","resolution":{"observed_at":"2026-07-13T00:57:35.442569Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-13T00:57:35.442569Z","title":"Text-Independent Phone-to-Audio Alignment Leveraging SSL (TIPAA-SSL) Pre-Trained Model Latent Representation and Knowledge Transfer,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.09020","last_updated":"2026-07-10T01:05:30Z","snapshot_observed_at":"2026-07-15T23:18:00.240166Z","submitted_at":"2026-07-10T01:05:30Z","title":"Phone Segmentation and Recognition through Phonological Activation Mapping","version":1},"reference_index":42,"source":"pdf_text","source_observed_at":"2026-07-13T00:57:35.442569Z"},"links":{"citing_paper":"/paper/2607.09020"},"observation_digest":"sha256:771c29464b34f0fe29a788d611b9b071c81ecb19de19f61ada4ccc7d5a009f43","observation_id":"3c66455a-767b-46a5-91c9-b3f2e5eab489","resolution":{"observed_at":"2026-07-13T00:57:35.442569Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-13T00:57:35.442569Z","title":"Self-Supervised Speech Representations are More Phonetic than Semantic,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.09020","last_updated":"2026-07-10T01:05:30Z","snapshot_observed_at":"2026-07-15T23:18:00.240166Z","submitted_at":"2026-07-10T01:05:30Z","title":"Phone Segmentation and Recognition through Phonological Activation Mapping","version":1},"reference_index":43,"source":"pdf_text","source_observed_at":"2026-07-13T00:57:35.442569Z"},"links":{"citing_paper":"/paper/2607.09020"},"observation_digest":"sha256:9a91ca6b227db769a0a236d3560d425df78b6019d5a38b508e07d1f256a5df9d","observation_id":"e887a5b0-5305-404d-8f0e-2ccfc18a278f","resolution":{"observed_at":"2026-07-13T00:57:35.442569Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-13T00:57:35.442569Z","title":"SciPy 1.0: Fundamental Algorithms for Scientific Computing in Python,","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2607.09020","last_updated":"2026-07-10T01:05:30Z","snapshot_observed_at":"2026-07-15T23:18:00.240166Z","submitted_at":"2026-07-10T01:05:30Z","title":"Phone Segmentation and Recognition through Phonological Activation Mapping","version":1},"reference_index":44,"source":"pdf_text","source_observed_at":"2026-07-13T00:57:35.442569Z"},"links":{"citing_paper":"/paper/2607.09020"},"observation_digest":"sha256:d9740aea0bc2c4f95c0f67fd10e48a79268d175b1e7e04d9c554cba59384d1f8","observation_id":"fa2e5b3b-d491-40f4-affc-83619330854e","resolution":{"observed_at":"2026-07-13T00:57:35.442569Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-13T00:57:35.442569Z","title":"A new text-independent method for phoneme segmentation,","venue":null,"work_id":null,"year":2001},"citing_paper":{"arxiv_id":"2607.09020","last_updated":"2026-07-10T01:05:30Z","snapshot_observed_at":"2026-07-15T23:18:00.240166Z","submitted_at":"2026-07-10T01:05:30Z","title":"Phone Segmentation and Recognition through Phonological Activation Mapping","version":1},"reference_index":45,"source":"pdf_text","source_observed_at":"2026-07-13T00:57:35.442569Z"},"links":{"citing_paper":"/paper/2607.09020"},"observation_digest":"sha256:7a9be1847c7fda1eb6925d54210454d7ef7054f3bc8440463dbf497bb194058d","observation_id":"407ba5ae-31de-453a-aa61-d82713ed45b2","resolution":{"observed_at":"2026-07-13T00:57:35.442569Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-13T00:57:35.442569Z","title":"Montreal forced aligner: Trainable text-speech alignment using kaldi,","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2607.09020","last_updated":"2026-07-10T01:05:30Z","snapshot_observed_at":"2026-07-15T23:18:00.240166Z","submitted_at":"2026-07-10T01:05:30Z","title":"Phone Segmentation and Recognition through Phonological Activation Mapping","version":1},"reference_index":46,"source":"pdf_text","source_observed_at":"2026-07-13T00:57:35.442569Z"},"links":{"citing_paper":"/paper/2607.09020"},"observation_digest":"sha256:8229b89bbdc7efd3aeb7d1de2a21f2f8716785f450376b9219e4992b70afcd7e","observation_id":"0856be8c-0903-4bc8-94d4-0aad2f0e93b4","resolution":{"observed_at":"2026-07-13T00:57:35.442569Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-13T00:57:35.442569Z","title":"XLSR Inclusive English Speech-to-IPA,","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.09020","last_updated":"2026-07-10T01:05:30Z","snapshot_observed_at":"2026-07-15T23:18:00.240166Z","submitted_at":"2026-07-10T01:05:30Z","title":"Phone Segmentation and Recognition through Phonological Activation Mapping","version":1},"reference_index":47,"source":"pdf_text","source_observed_at":"2026-07-13T00:57:35.442569Z"},"links":{"citing_paper":"/paper/2607.09020"},"observation_digest":"sha256:bde04df5785bf0712e0f45b09de0f60358606788dfd5d3fc0aad24782ad19c33","observation_id":"a5e8040c-f40f-47d8-bb09-11111b34987b","resolution":{"observed_at":"2026-07-13T00:57:35.442569Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-13T00:57:35.442569Z","title":"L2-ARCTIC: A Non-native English Speech Corpus,","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2607.09020","last_updated":"2026-07-10T01:05:30Z","snapshot_observed_at":"2026-07-15T23:18:00.240166Z","submitted_at":"2026-07-10T01:05:30Z","title":"Phone Segmentation and Recognition through Phonological Activation Mapping","version":1},"reference_index":48,"source":"pdf_text","source_observed_at":"2026-07-13T00:57:35.442569Z"},"links":{"citing_paper":"/paper/2607.09020"},"observation_digest":"sha256:68aa368a99326a80a16342069bdf94ffad5d6c6cf200f3ff5cf09aa16485c8dc","observation_id":"6827d785-ad25-4f0e-a24f-522b86df9c74","resolution":{"observed_at":"2026-07-13T00:57:35.442569Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-13T00:57:35.442569Z","title":"Speech Accent Archive,","venue":null,"work_id":null,"year":2015},"citing_paper":{"arxiv_id":"2607.09020","last_updated":"2026-07-10T01:05:30Z","snapshot_observed_at":"2026-07-15T23:18:00.240166Z","submitted_at":"2026-07-10T01:05:30Z","title":"Phone Segmentation and Recognition through Phonological Activation Mapping","version":1},"reference_index":49,"source":"pdf_text","source_observed_at":"2026-07-13T00:57:35.442569Z"},"links":{"citing_paper":"/paper/2607.09020"},"observation_digest":"sha256:06bb20b7691fdd2b1f7a9544777f77ca268a70920486e24c78795ca0015d73a3","observation_id":"af6fc254-ee22-4d9b-bb2b-f251c42f805c","resolution":{"observed_at":"2026-07-13T00:57:35.442569Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-13T00:57:35.442569Z","title":"Building a time-aligned cross-linguistic reference corpus from language documentation data (DoReCo),","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2607.09020","last_updated":"2026-07-10T01:05:30Z","snapshot_observed_at":"2026-07-15T23:18:00.240166Z","submitted_at":"2026-07-10T01:05:30Z","title":"Phone Segmentation and Recognition through Phonological Activation Mapping","version":1},"reference_index":50,"source":"pdf_text","source_observed_at":"2026-07-13T00:57:35.442569Z"},"links":{"citing_paper":"/paper/2607.09020"},"observation_digest":"sha256:df44b16e78cad5a86e2f95c166803b5e36e383d3131d3af6d28576924c1a5579","observation_id":"4128b828-76c0-4cdd-9175-cf73e1209663","resolution":{"observed_at":"2026-07-13T00:57:35.442569Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-13T00:57:35.442569Z","title":"Scaling human and g2p supervision for robust phonetic transcription,","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2607.09020","last_updated":"2026-07-10T01:05:30Z","snapshot_observed_at":"2026-07-15T23:18:00.240166Z","submitted_at":"2026-07-10T01:05:30Z","title":"Phone Segmentation and Recognition through Phonological Activation Mapping","version":1},"reference_index":51,"source":"pdf_text","source_observed_at":"2026-07-13T00:57:35.442569Z"},"links":{"citing_paper":"/paper/2607.09020"},"observation_digest":"sha256:b7fc7170379293634759ee4ed0660a86eaa68beea29a416c407b65ef34387c54","observation_id":"6edbb141-0841-4c03-948a-3739e4545238","resolution":{"observed_at":"2026-07-13T00:57:35.442569Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-13T00:57:35.442569Z","title":"Global TIMIT learner simple english,","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2607.09020","last_updated":"2026-07-10T01:05:30Z","snapshot_observed_at":"2026-07-15T23:18:00.240166Z","submitted_at":"2026-07-10T01:05:30Z","title":"Phone Segmentation and Recognition through Phonological Activation Mapping","version":1},"reference_index":52,"source":"pdf_text","source_observed_at":"2026-07-13T00:57:35.442569Z"},"links":{"citing_paper":"/paper/2607.09020"},"observation_digest":"sha256:864099d81b577887ac092f1fafbae2c9eaa591af9a676aa8d8f6b5ab701c08dd","observation_id":"bfe146eb-12dc-431e-89b9-3b3da55fadd2","resolution":{"observed_at":"2026-07-13T00:57:35.442569Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-13T00:57:35.442569Z","title":"Global TIMIT learner treebank english,","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2607.09020","last_updated":"2026-07-10T01:05:30Z","snapshot_observed_at":"2026-07-15T23:18:00.240166Z","submitted_at":"2026-07-10T01:05:30Z","title":"Phone Segmentation and Recognition through Phonological Activation Mapping","version":1},"reference_index":53,"source":"pdf_text","source_observed_at":"2026-07-13T00:57:35.442569Z"},"links":{"citing_paper":"/paper/2607.09020"},"observation_digest":"sha256:60453f70613555765f6547d2cd5e88d9dff753b5f11e5380d56dbeb735615aec","observation_id":"a980baf9-78e0-49ad-a7dc-64dd303576df","resolution":{"observed_at":"2026-07-13T00:57:35.442569Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-13T00:57:35.442569Z","title":"Global TIMIT Thai,","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2607.09020","last_updated":"2026-07-10T01:05:30Z","snapshot_observed_at":"2026-07-15T23:18:00.240166Z","submitted_at":"2026-07-10T01:05:30Z","title":"Phone Segmentation and Recognition through Phonological Activation Mapping","version":1},"reference_index":54,"source":"pdf_text","source_observed_at":"2026-07-13T00:57:35.442569Z"},"links":{"citing_paper":"/paper/2607.09020"},"observation_digest":"sha256:58a0b0eebdb6e5df99d4a25b30cf78f220b1316a45df38c2c3859fce16ea6d62","observation_id":"e0ea52e4-e6f7-4ac2-810b-ad47ba3e7e05","resolution":{"observed_at":"2026-07-13T00:57:35.442569Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-13T00:57:35.442569Z","title":"Dysarthric speech corpus in Tamil for rehabilitation research,","venue":null,"work_id":null,"year":2016},"citing_paper":{"arxiv_id":"2607.09020","last_updated":"2026-07-10T01:05:30Z","snapshot_observed_at":"2026-07-15T23:18:00.240166Z","submitted_at":"2026-07-10T01:05:30Z","title":"Phone Segmentation and Recognition through Phonological Activation Mapping","version":1},"reference_index":55,"source":"pdf_text","source_observed_at":"2026-07-13T00:57:35.442569Z"},"links":{"citing_paper":"/paper/2607.09020"},"observation_digest":"sha256:0c38b25f67c573a72d124628505abd3db52e0b95b7d1fb163879aafb5ea98f40","observation_id":"68a9c72a-a699-4da2-b4eb-5a1451d20392","resolution":{"observed_at":"2026-07-13T00:57:35.442569Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-13T00:57:35.442569Z","title":"A weighted speaker-specific confusion transducer-based augmentative and alternative speech communication aid for dysarthric speakers,","venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2607.09020","last_updated":"2026-07-10T01:05:30Z","snapshot_observed_at":"2026-07-15T23:18:00.240166Z","submitted_at":"2026-07-10T01:05:30Z","title":"Phone Segmentation and Recognition through Phonological Activation Mapping","version":1},"reference_index":56,"source":"pdf_text","source_observed_at":"2026-07-13T00:57:35.442569Z"},"links":{"citing_paper":"/paper/2607.09020"},"observation_digest":"sha256:da2a9fd20bb1ec09bad609d7912ff66da05806a29819cd6512b0214dd6546ee9","observation_id":"bfd23527-10e3-4cf8-a955-10e5ce9dd5c2","resolution":{"observed_at":"2026-07-13T00:57:35.442569Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-13T00:57:35.442569Z","title":"The TORGO database of acoustic and articulatory speech from speakers with dysarthria,","venue":null,"work_id":null,"year":2012},"citing_paper":{"arxiv_id":"2607.09020","last_updated":"2026-07-10T01:05:30Z","snapshot_observed_at":"2026-07-15T23:18:00.240166Z","submitted_at":"2026-07-10T01:05:30Z","title":"Phone Segmentation and Recognition through Phonological Activation Mapping","version":1},"reference_index":57,"source":"pdf_text","source_observed_at":"2026-07-13T00:57:35.442569Z"},"links":{"citing_paper":"/paper/2607.09020"},"observation_digest":"sha256:dc495358619dc96b0cdecf060e130a50f581ba14337467c44a2646129c814590","observation_id":"b678ea2a-0e69-402b-8589-c90b6f77f856","resolution":{"observed_at":"2026-07-13T00:57:35.442569Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-13T00:57:35.442569Z","title":"Dysarthria detection and severity assessment using rhythm-based metrics","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2607.09020","last_updated":"2026-07-10T01:05:30Z","snapshot_observed_at":"2026-07-15T23:18:00.240166Z","submitted_at":"2026-07-10T01:05:30Z","title":"Phone Segmentation and Recognition through Phonological Activation Mapping","version":1},"reference_index":58,"source":"pdf_text","source_observed_at":"2026-07-13T00:57:35.442569Z"},"links":{"citing_paper":"/paper/2607.09020"},"observation_digest":"sha256:94ee1ca592f1b48051944ede54042757293486c1b6d64e0cfbd3658ee179d0ab","observation_id":"249a241f-1f6c-4960-a88b-548fb9c8422d","resolution":{"observed_at":"2026-07-13T00:57:35.442569Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-13T00:57:35.442569Z","title":"An improved speech segmentation quality measure: the r-value,","venue":null,"work_id":null,"year":2009},"citing_paper":{"arxiv_id":"2607.09020","last_updated":"2026-07-10T01:05:30Z","snapshot_observed_at":"2026-07-15T23:18:00.240166Z","submitted_at":"2026-07-10T01:05:30Z","title":"Phone Segmentation and Recognition through Phonological Activation Mapping","version":1},"reference_index":59,"source":"pdf_text","source_observed_at":"2026-07-13T00:57:35.442569Z"},"links":{"citing_paper":"/paper/2607.09020"},"observation_digest":"sha256:4618dc8dbdc13b66f0c0ba0670700d6f982165f3d39e3c676cc8e02d0669c28f","observation_id":"81c23fa9-c196-40dd-accf-5c81ec332d48","resolution":{"observed_at":"2026-07-13T00:57:35.442569Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-13T00:57:35.442569Z","title":"English mfa acoustic model v3.1.0,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.09020","last_updated":"2026-07-10T01:05:30Z","snapshot_observed_at":"2026-07-15T23:18:00.240166Z","submitted_at":"2026-07-10T01:05:30Z","title":"Phone Segmentation and Recognition through Phonological Activation Mapping","version":1},"reference_index":60,"source":"pdf_text","source_observed_at":"2026-07-13T00:57:35.442569Z"},"links":{"citing_paper":"/paper/2607.09020"},"observation_digest":"sha256:28686852f376ddf39ffd3b060e94f8598ea5c813bd0cc342e3ae8b0f8da57c56","observation_id":"66565d3e-77f4-4548-9ad6-47aebe653174","resolution":{"observed_at":"2026-07-13T00:57:35.442569Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-13T00:57:35.442569Z","title":"V oxcommunis corpus,","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2607.09020","last_updated":"2026-07-10T01:05:30Z","snapshot_observed_at":"2026-07-15T23:18:00.240166Z","submitted_at":"2026-07-10T01:05:30Z","title":"Phone Segmentation and Recognition through Phonological Activation Mapping","version":1},"reference_index":61,"source":"pdf_text","source_observed_at":"2026-07-13T00:57:35.442569Z"},"links":{"citing_paper":"/paper/2607.09020"},"observation_digest":"sha256:3eb23395faa0af9f89451cdc8a938ea87a6dfed98da19a5cf0a3570a67013f96","observation_id":"c0c58d9a-bc06-49b4-9c68-d306f2fc0628","resolution":{"observed_at":"2026-07-13T00:57:35.442569Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-13T00:57:35.442569Z","title":"Thai mfa acoustic model v3.0.0,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.09020","last_updated":"2026-07-10T01:05:30Z","snapshot_observed_at":"2026-07-15T23:18:00.240166Z","submitted_at":"2026-07-10T01:05:30Z","title":"Phone Segmentation and Recognition through Phonological Activation Mapping","version":1},"reference_index":62,"source":"pdf_text","source_observed_at":"2026-07-13T00:57:35.442569Z"},"links":{"citing_paper":"/paper/2607.09020"},"observation_digest":"sha256:a9ebf298f9c792c752b7345370c1c8d3e85e0b86272251724177c67d7a9c005b","observation_id":"c1f6c27d-80d9-4f6d-9265-6b31b35bfb1c","resolution":{"observed_at":"2026-07-13T00:57:35.442569Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-13T00:57:35.442569Z","title":"Wav2Gloss: Generating Interlinear Glossed Text from Speech,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.09020","last_updated":"2026-07-10T01:05:30Z","snapshot_observed_at":"2026-07-15T23:18:00.240166Z","submitted_at":"2026-07-10T01:05:30Z","title":"Phone Segmentation and Recognition through Phonological Activation Mapping","version":1},"reference_index":63,"source":"pdf_text","source_observed_at":"2026-07-13T00:57:35.442569Z"},"links":{"citing_paper":"/paper/2607.09020"},"observation_digest":"sha256:567794cbd924333cbbc6b2ab0cf4c9b453934b6123e3eb82fb728cda6568d120","observation_id":"c9e0c1f6-5bb1-4edb-9d92-d70de0442bc6","resolution":{"observed_at":"2026-07-13T00:57:35.442569Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-13T00:57:35.442569Z","title":"XLS-R: Self-supervised Cross-lingual Speech Representation Learning at Scale,","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2607.09020","last_updated":"2026-07-10T01:05:30Z","snapshot_observed_at":"2026-07-15T23:18:00.240166Z","submitted_at":"2026-07-10T01:05:30Z","title":"Phone Segmentation and Recognition through Phonological Activation Mapping","version":1},"reference_index":64,"source":"pdf_text","source_observed_at":"2026-07-13T00:57:35.442569Z"},"links":{"citing_paper":"/paper/2607.09020"},"observation_digest":"sha256:c3ee2f9cca048d9ae90cafd16bfbbeed21563ab18fba47162509db1a3f4103b1","observation_id":"720973fc-af65-488e-ae0f-d563e623b9b9","resolution":{"observed_at":"2026-07-13T00:57:35.442569Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-13T00:57:35.442569Z","title":"Towards unsupervised phone and word segmentation using self-supervised vector-quantized neural networks,","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2607.09020","last_updated":"2026-07-10T01:05:30Z","snapshot_observed_at":"2026-07-15T23:18:00.240166Z","submitted_at":"2026-07-10T01:05:30Z","title":"Phone Segmentation and Recognition through Phonological Activation Mapping","version":1},"reference_index":65,"source":"pdf_text","source_observed_at":"2026-07-13T00:57:35.442569Z"},"links":{"citing_paper":"/paper/2607.09020"},"observation_digest":"sha256:01c9ea7ab7e221ae3cbd579ebc6826d9c51b96dfc49896a0325fd6aa5c900ef2","observation_id":"d08cc2fa-334e-4eee-9842-f37c909ae23d","resolution":{"observed_at":"2026-07-13T00:57:35.442569Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"paper":{"arxiv_id":"2607.09020","last_updated":"2026-07-10T01:05:30Z","latest_version":1,"primary_category":"eess.AS","snapshot_observed_at":"2026-07-15T23:18:00.240166Z","submitted_at":"2026-07-10T01:05:30Z","title":"Phone Segmentation and Recognition through Phonological Activation Mapping"},"reference_resolution":{"displayed":65,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":65,"verified_exact":0,"verified_fuzzy":0},"total_outbound_references":65},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"thesis":"As of 9 August 2026, this Paper Citation Record lists 65 of 65 outbound references and 0 inbound Pith citation observations for arXiv:2607.09020."}