{"as_of":"2026-08-15T12:39:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:790c886a86cf9cc03351aa353dfebd78e415e06ed4f060619613a4a5abbce21c","coverage":[{"denominator":57,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":57,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-11T23:52:36.789445Z","state":"measured"},{"denominator":57,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":57,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-15T06:32:42.880941+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2412.02164/citation-record","integrity":"/paper/2412.02164/integrity","json":"/paper/2412.02164/citation-record.json","paper":"/paper/2412.02164"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T23:52:37.861500Z","title":"Word embeddings for speech recognition,","venue":null,"work_id":"4f2c75dd-8903-4a3b-b7e3-69bfd98d7456","year":2014},"citing_paper":{"arxiv_id":"2412.02164","last_updated":"2024-12-03T04:48:59Z","snapshot_observed_at":"2026-08-14T22:10:18.153994Z","submitted_at":"2024-12-03T04:48:59Z","title":"A Theoretical Framework for Acoustic Neighbor Embeddings","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-11T23:52:36.517888Z"},"links":{"citing_paper":"/paper/2412.02164"},"observation_digest":"sha256:5e519feec02cdee77e7c8db8fb3575bfe85f554145adcc304defa8a56a141b82","observation_id":"8e58e571-ad2e-4867-aec6-ba09744806e5","resolution":{"observed_at":"2026-08-11T23:52:37.866465Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T23:52:37.845650Z","title":"Fixed-dimensional acoustic embeddings of variable-length segments in low-resource set- tings,","venue":null,"work_id":"3c9c1d44-e70f-408c-bada-66b0044b9cfc","year":2013},"citing_paper":{"arxiv_id":"2412.02164","last_updated":"2024-12-03T04:48:59Z","snapshot_observed_at":"2026-08-14T22:10:18.153994Z","submitted_at":"2024-12-03T04:48:59Z","title":"A Theoretical Framework for Acoustic Neighbor Embeddings","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-11T23:52:36.523124Z"},"links":{"citing_paper":"/paper/2412.02164"},"observation_digest":"sha256:cc1770ae00c4ca7f50c82a9647c44c2e3b1106ba3591ba57282e24d1e0983de0","observation_id":"c5d26830-de4f-4a34-9e81-baba78c9854a","resolution":{"observed_at":"2026-08-11T23:52:37.850610Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T23:52:37.829742Z","title":"Query-by-Example Search with Discriminative Neural Acoustic Word Embeddings,","venue":null,"work_id":"ef29e532-48ac-470c-b2ac-ce16694d7804","year":2017},"citing_paper":{"arxiv_id":"2412.02164","last_updated":"2024-12-03T04:48:59Z","snapshot_observed_at":"2026-08-14T22:10:18.153994Z","submitted_at":"2024-12-03T04:48:59Z","title":"A Theoretical Framework for Acoustic Neighbor Embeddings","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-11T23:52:36.528047Z"},"links":{"citing_paper":"/paper/2412.02164"},"observation_digest":"sha256:77436ad1a7bb3b5b75d3f163ab24ffedabc5c3ddc21547f4d4b5ac8c6125b16d","observation_id":"961dbc2b-c940-46c3-860d-6638d3c5531e","resolution":{"observed_at":"2026-08-11T23:52:37.835217Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T23:52:37.813850Z","title":"Query-by-example keyword spotting using long short-term memory networks,","venue":null,"work_id":"5ab399a0-5669-4733-a8ab-8d52ee2af572","year":2015},"citing_paper":{"arxiv_id":"2412.02164","last_updated":"2024-12-03T04:48:59Z","snapshot_observed_at":"2026-08-14T22:10:18.153994Z","submitted_at":"2024-12-03T04:48:59Z","title":"A Theoretical Framework for Acoustic Neighbor Embeddings","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-11T23:52:36.533230Z"},"links":{"citing_paper":"/paper/2412.02164"},"observation_digest":"sha256:8f681869a0bdca2aad26ddc1dcdee274b69b824147fb9f4c05a4d702cece3c95","observation_id":"96f1df78-65e6-4f3e-a30e-356c0bfed557","resolution":{"observed_at":"2026-08-11T23:52:37.818911Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T23:52:37.798380Z","title":"Learned in speech recognition: Contextual acoustic word embeddings,","venue":null,"work_id":"be804a6c-7ddf-427e-bb54-bd6a9a6e687c","year":2019},"citing_paper":{"arxiv_id":"2412.02164","last_updated":"2024-12-03T04:48:59Z","snapshot_observed_at":"2026-08-14T22:10:18.153994Z","submitted_at":"2024-12-03T04:48:59Z","title":"A Theoretical Framework for Acoustic Neighbor Embeddings","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-11T23:52:36.538322Z"},"links":{"citing_paper":"/paper/2412.02164"},"observation_digest":"sha256:47916e7f2448e6b34f25b4a252c15b7ce5888d651d478291018f11f38c5b1dac","observation_id":"7981b7a0-470e-4946-80e5-2e7035eeed02","resolution":{"observed_at":"2026-08-11T23:52:37.803379Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T23:52:37.782414Z","title":"Deep convolutional acoustic word embeddings using word-pair side information,","venue":null,"work_id":"4032f59e-91b9-4785-a822-7ce097664808","year":2016},"citing_paper":{"arxiv_id":"2412.02164","last_updated":"2024-12-03T04:48:59Z","snapshot_observed_at":"2026-08-14T22:10:18.153994Z","submitted_at":"2024-12-03T04:48:59Z","title":"A Theoretical Framework for Acoustic Neighbor Embeddings","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-11T23:52:36.543188Z"},"links":{"citing_paper":"/paper/2412.02164"},"observation_digest":"sha256:9558a31a18dc60de47b17027ebdaad5d963217e27067c70cb3d7e25dabc7d15f","observation_id":"47208d4b-6579-44cc-962d-27d0813e7f5a","resolution":{"observed_at":"2026-08-11T23:52:37.787541Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T23:52:37.766403Z","title":"Discriminative acoustic word embeddings: Recurrent neural network-based approaches,","venue":null,"work_id":"94da610b-0f23-473a-a439-d450d3070f9c","year":2016},"citing_paper":{"arxiv_id":"2412.02164","last_updated":"2024-12-03T04:48:59Z","snapshot_observed_at":"2026-08-14T22:10:18.153994Z","submitted_at":"2024-12-03T04:48:59Z","title":"A Theoretical Framework for Acoustic Neighbor Embeddings","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-11T23:52:36.548610Z"},"links":{"citing_paper":"/paper/2412.02164"},"observation_digest":"sha256:97c4ba1bdf585d92b2fa95f9c900a6d8a415393562e5d46bb8f59ec610afa0ff","observation_id":"c273ef37-0b4f-483c-9bf2-6bc9718ae852","resolution":{"observed_at":"2026-08-11T23:52:37.771720Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T23:52:37.750240Z","title":"Audio word2vec: Sequence-to-sequence autoencoding for unsupervised learn- ing of audio segmentation and representation,","venue":null,"work_id":"b64aa56d-25d5-473f-be99-b2fe0511d369","year":2019},"citing_paper":{"arxiv_id":"2412.02164","last_updated":"2024-12-03T04:48:59Z","snapshot_observed_at":"2026-08-14T22:10:18.153994Z","submitted_at":"2024-12-03T04:48:59Z","title":"A Theoretical Framework for Acoustic Neighbor Embeddings","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-11T23:52:36.553280Z"},"links":{"citing_paper":"/paper/2412.02164"},"observation_digest":"sha256:47913b15b49d5f22e458a6059aa727ff0a844a5ea30212a1374f67a13ca40a8a","observation_id":"a5a1ab38-d468-466f-b197-07bd0772a408","resolution":{"observed_at":"2026-08-11T23:52:37.755568Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T23:52:37.733408Z","title":"Improved acoustic word embeddings for zero-resource languages using multilingual transfer,","venue":null,"work_id":"414aef58-bf3f-4446-ad7c-346d1638ffc0","year":2021},"citing_paper":{"arxiv_id":"2412.02164","last_updated":"2024-12-03T04:48:59Z","snapshot_observed_at":"2026-08-14T22:10:18.153994Z","submitted_at":"2024-12-03T04:48:59Z","title":"A Theoretical Framework for Acoustic Neighbor Embeddings","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-11T23:52:36.557980Z"},"links":{"citing_paper":"/paper/2412.02164"},"observation_digest":"sha256:0f79006531416cc29d67903c51664a0d06e96a6f37e5f0b6f8bc4947c61dc068","observation_id":"793ba21b-ce00-41dc-96d0-40bfbfa8655f","resolution":{"observed_at":"2026-08-11T23:52:37.738533Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T23:52:37.717035Z","title":"Multi-view recurrent neural acoustic word embeddings,","venue":null,"work_id":"9e4a4c91-e410-44c8-8337-f066bd97faf6","year":2017},"citing_paper":{"arxiv_id":"2412.02164","last_updated":"2024-12-03T04:48:59Z","snapshot_observed_at":"2026-08-14T22:10:18.153994Z","submitted_at":"2024-12-03T04:48:59Z","title":"A Theoretical Framework for Acoustic Neighbor Embeddings","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-11T23:52:36.562656Z"},"links":{"citing_paper":"/paper/2412.02164"},"observation_digest":"sha256:9ba978861ad261f1e91dfcb247800bcd61617c38076980432e305ca78face613","observation_id":"3981c89d-3aa3-4ead-b264-820dccb73646","resolution":{"observed_at":"2026-08-11T23:52:37.721902Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T23:52:37.701174Z","title":"The measurement of phonetic similarity,","venue":null,"work_id":"049d4334-35ea-401d-a591-422fd2b143f0","year":1969},"citing_paper":{"arxiv_id":"2412.02164","last_updated":"2024-12-03T04:48:59Z","snapshot_observed_at":"2026-08-14T22:10:18.153994Z","submitted_at":"2024-12-03T04:48:59Z","title":"A Theoretical Framework for Acoustic Neighbor Embeddings","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-11T23:52:36.567303Z"},"links":{"citing_paper":"/paper/2412.02164"},"observation_digest":"sha256:9f41fc93c7c6d3b11ab70c4e4f6a61b8eeb2966e3ca2053a6fe822eb819f544f","observation_id":"932c178b-1a84-4ba1-8a26-7d0607bde6a1","resolution":{"observed_at":"2026-08-11T23:52:37.706258Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T23:52:37.685307Z","title":"Predicting the judged “similarity of sound","venue":null,"work_id":"9f327f79-a864-4e7c-b7f2-aaba83e0952e","year":1973},"citing_paper":{"arxiv_id":"2412.02164","last_updated":"2024-12-03T04:48:59Z","snapshot_observed_at":"2026-08-14T22:10:18.153994Z","submitted_at":"2024-12-03T04:48:59Z","title":"A Theoretical Framework for Acoustic Neighbor Embeddings","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-11T23:52:36.572487Z"},"links":{"citing_paper":"/paper/2412.02164"},"observation_digest":"sha256:d0cfc65b48fa91b26dc1ce8d63742ce69622f384b4d96af8235367fad1dd3dc5","observation_id":"0f5276f8-4eba-41be-9049-b0e81b81e549","resolution":{"observed_at":"2026-08-11T23:52:37.690159Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2005.00153","last_updated":"2020-05-10T08:29:28Z","snapshot_observed_at":"2026-07-06T09:16:45.827004Z","submitted_at":"2020-05-01T00:18:31Z","title":"Enriching Documents with Compact, Representative, Relevant Knowledge Graphs","version":2},"cited_work":{"arxiv_id":"2005.00153","doi":null,"metadata_source":"pith","pith_arxiv_id":"2005.00153","snapshot_observed_at":"2026-08-11T23:52:37.094921Z","title":"Enriching Documents with Compact, Representative, Relevant Knowledge Graphs","venue":"cs.AI","work_id":"7a69479b-9118-49cb-a293-f3b40ff5b19b","year":2020},"citing_paper":{"arxiv_id":"2412.02164","last_updated":"2024-12-03T04:48:59Z","snapshot_observed_at":"2026-08-14T22:10:18.153994Z","submitted_at":"2024-12-03T04:48:59Z","title":"A Theoretical Framework for Acoustic Neighbor Embeddings","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-11T23:52:36.577375Z"},"links":{"cited_paper":"/paper/2005.00153","citing_paper":"/paper/2412.02164"},"observation_digest":"sha256:db8d6e397481e49d9176a5b89cd58072df2928b1c5e28f30153d2c8d7f3d6d6c","observation_id":"52456f0f-3818-4b86-8258-cd8aa91d265d","resolution":{"observed_at":"2026-08-11T23:52:37.100792Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T23:52:37.670139Z","title":"What makes words sound similar?","venue":null,"work_id":"396750be-eb7f-47cc-9a74-7cd6242ae9e9","year":2005},"citing_paper":{"arxiv_id":"2412.02164","last_updated":"2024-12-03T04:48:59Z","snapshot_observed_at":"2026-08-14T22:10:18.153994Z","submitted_at":"2024-12-03T04:48:59Z","title":"A Theoretical Framework for Acoustic Neighbor Embeddings","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-11T23:52:36.582542Z"},"links":{"citing_paper":"/paper/2412.02164"},"observation_digest":"sha256:d75070adab52a92e405f3f7027ba89e5839278ca08adf73da653e13646ff5ead","observation_id":"91497763-8264-438b-b699-d07a7abef8ac","resolution":{"observed_at":"2026-08-11T23:52:37.675237Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2007.10329","last_updated":"2022-01-06T23:14:11Z","snapshot_observed_at":"2026-08-12T22:59:36.182659Z","submitted_at":"2020-07-20T05:33:07Z","title":"Acoustic Neighbor Embeddings","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2007.10329","snapshot_observed_at":"2026-08-11T23:52:36.587221Z","title":"Acoustic neighbor embeddings,","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2412.02164","last_updated":"2024-12-03T04:48:59Z","snapshot_observed_at":"2026-08-14T22:10:18.153994Z","submitted_at":"2024-12-03T04:48:59Z","title":"A Theoretical Framework for Acoustic Neighbor Embeddings","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-11T23:52:36.587221Z"},"links":{"cited_paper":"/paper/2007.10329","citing_paper":"/paper/2412.02164"},"observation_digest":"sha256:0fc4c959c88380dacb1f28d9a6acb40f9e894ef4227a6ce38e33598065485848","observation_id":"678be2cb-fcad-4301-9b27-c5d8236397b3","resolution":{"observed_at":"2026-08-11T23:52:36.587221Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T23:52:37.654403Z","title":"Stochastic neighbor embedding,","venue":null,"work_id":"f81eba6d-3c1a-4b4e-8217-08d98ed4386c","year":2003},"citing_paper":{"arxiv_id":"2412.02164","last_updated":"2024-12-03T04:48:59Z","snapshot_observed_at":"2026-08-14T22:10:18.153994Z","submitted_at":"2024-12-03T04:48:59Z","title":"A Theoretical Framework for Acoustic Neighbor Embeddings","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-11T23:52:36.592494Z"},"links":{"citing_paper":"/paper/2412.02164"},"observation_digest":"sha256:c3b007071cbe94c1f3968bd8b9e0684d4b67fcfea54389daf1c7576c6653d4ef","observation_id":"fd3eb34a-465d-4f16-8687-bc9299c4fa02","resolution":{"observed_at":"2026-08-11T23:52:37.659233Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T23:52:37.638537Z","title":"User-Initiated Repetition-Based Recovery in Multi-Utterance Dialogue Systems,","venue":null,"work_id":"6f068743-8b5b-4a7c-80c8-07504e8514c0","year":2021},"citing_paper":{"arxiv_id":"2412.02164","last_updated":"2024-12-03T04:48:59Z","snapshot_observed_at":"2026-08-14T22:10:18.153994Z","submitted_at":"2024-12-03T04:48:59Z","title":"A Theoretical Framework for Acoustic Neighbor Embeddings","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-11T23:52:36.597937Z"},"links":{"citing_paper":"/paper/2412.02164"},"observation_digest":"sha256:209c2bf204f4241d4bc1f0ddad0816d66914d3acb85a52834dab903470755d2d","observation_id":"89dfb86f-5994-4681-a2f5-628b39153506","resolution":{"observed_at":"2026-08-11T23:52:37.643581Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2210.16726","last_updated":"2023-02-19T21:10:18Z","snapshot_observed_at":"2026-08-13T13:53:50.277296Z","submitted_at":"2022-10-30T02:37:55Z","title":"Improvements to Embedding-Matching Acoustic-to-Word ASR Using Multiple-Hypothesis Pronunciation-Based Embeddings","version":2},"cited_work":{"arxiv_id":"2210.16726","doi":null,"metadata_source":"pith","pith_arxiv_id":"2210.16726","snapshot_observed_at":"2026-08-11T23:52:37.053298Z","title":"Improvements to Embedding-Matching Acoustic-to-Word ASR Using Multiple-Hypothesis Pronunciation-Based Embeddings","venue":"eess.AS","work_id":"78289de9-e420-469f-b150-de399251caba","year":2022},"citing_paper":{"arxiv_id":"2412.02164","last_updated":"2024-12-03T04:48:59Z","snapshot_observed_at":"2026-08-14T22:10:18.153994Z","submitted_at":"2024-12-03T04:48:59Z","title":"A Theoretical Framework for Acoustic Neighbor Embeddings","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-11T23:52:36.602492Z"},"links":{"cited_paper":"/paper/2210.16726","citing_paper":"/paper/2412.02164"},"observation_digest":"sha256:efd20a720327547a4ce83adb53cf7bd8b24211ce2157448e1625b02d71446d4b","observation_id":"ff5a68f8-5f50-4ff4-8d0d-464e85e14d30","resolution":{"observed_at":"2026-08-11T23:52:37.059385Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2409.06062","last_updated":"2024-09-09T20:52:25Z","snapshot_observed_at":"2026-08-12T22:48:12.604186Z","submitted_at":"2024-09-09T20:52:25Z","title":"Retrieval Augmented Correction of Named Entity Speech Recognition Errors","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2409.06062","snapshot_observed_at":"2026-08-11T23:52:36.607512Z","title":"Retrieval augmented correction of named entity speech recognition errors,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2412.02164","last_updated":"2024-12-03T04:48:59Z","snapshot_observed_at":"2026-08-14T22:10:18.153994Z","submitted_at":"2024-12-03T04:48:59Z","title":"A Theoretical Framework for Acoustic Neighbor Embeddings","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-11T23:52:36.607512Z"},"links":{"cited_paper":"/paper/2409.06062","citing_paper":"/paper/2412.02164"},"observation_digest":"sha256:d5099ac8898b364fdde5d12de5f8d86ef823443c483e1293d859d8da2e501525","observation_id":"26843d59-2e2c-48fb-8daf-955c640ff8c5","resolution":{"observed_at":"2026-08-11T23:52:36.607512Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T23:52:37.622034Z","title":"Libriheavy: a 50,000 hours ASR corpus with punctuation casing and context,","venue":null,"work_id":"f3174126-3d8b-496a-81c4-8159fa7283f2","year":2023},"citing_paper":{"arxiv_id":"2412.02164","last_updated":"2024-12-03T04:48:59Z","snapshot_observed_at":"2026-08-14T22:10:18.153994Z","submitted_at":"2024-12-03T04:48:59Z","title":"A Theoretical Framework for Acoustic Neighbor Embeddings","version":1},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-11T23:52:36.612520Z"},"links":{"citing_paper":"/paper/2412.02164"},"observation_digest":"sha256:263d7890d5635002a29a536609f4284919f6544d21f4d3d3493468d82c900f16","observation_id":"9d9803a7-14d5-441f-90a0-fcdca64d710e","resolution":{"observed_at":"2026-08-11T23:52:37.627352Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T23:52:37.605735Z","title":null,"venue":null,"work_id":"607fb4e5-a8ee-46a8-819a-31551471087d","year":2000},"citing_paper":{"arxiv_id":"2412.02164","last_updated":"2024-12-03T04:48:59Z","snapshot_observed_at":"2026-08-14T22:10:18.153994Z","submitted_at":"2024-12-03T04:48:59Z","title":"A Theoretical Framework for Acoustic Neighbor Embeddings","version":1},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-11T23:52:36.617449Z"},"links":{"citing_paper":"/paper/2412.02164"},"observation_digest":"sha256:befc80f0336e6b97683272b25d309d73c7c5ab7e2eb392e458e8f660a9c9ff57","observation_id":"52cd61b4-f27a-40af-813b-941693d5559a","resolution":{"observed_at":"2026-08-11T23:52:37.610588Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T23:52:37.589563Z","title":"A derivation of minimum classification error from the theoretical classification risk using parzen estimation,","venue":null,"work_id":"67c55e49-dd51-4e30-a5e7-ce2b81568879","year":2004},"citing_paper":{"arxiv_id":"2412.02164","last_updated":"2024-12-03T04:48:59Z","snapshot_observed_at":"2026-08-14T22:10:18.153994Z","submitted_at":"2024-12-03T04:48:59Z","title":"A Theoretical Framework for Acoustic Neighbor Embeddings","version":1},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-11T23:52:36.622252Z"},"links":{"citing_paper":"/paper/2412.02164"},"observation_digest":"sha256:c92cab7c18839e8c69b3909ee911514fab544bb10d525933c879570f1846b55f","observation_id":"a28205c9-d954-4eda-a3bc-b0723bad0af6","resolution":{"observed_at":"2026-08-11T23:52:37.594391Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T23:52:37.574213Z","title":"An analysis of perceptual confusions among some english consonants,","venue":null,"work_id":"0dbb7d52-d0fc-45a4-80f2-75bbd4d933c0","year":1955},"citing_paper":{"arxiv_id":"2412.02164","last_updated":"2024-12-03T04:48:59Z","snapshot_observed_at":"2026-08-14T22:10:18.153994Z","submitted_at":"2024-12-03T04:48:59Z","title":"A Theoretical Framework for Acoustic Neighbor Embeddings","version":1},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-11T23:52:36.627036Z"},"links":{"citing_paper":"/paper/2412.02164"},"observation_digest":"sha256:f030e983188e2fa62626c3f25d7fbd3a492f7396d1c709828bffa1787d9c2cf5","observation_id":"91824249-cac4-4467-8ef8-62ed874a22a4","resolution":{"observed_at":"2026-08-11T23:52:37.579516Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T23:52:36.631797Z","title":"Low dimensional measurement of vowels using machine perception,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2412.02164","last_updated":"2024-12-03T04:48:59Z","snapshot_observed_at":"2026-08-14T22:10:18.153994Z","submitted_at":"2024-12-03T04:48:59Z","title":"A Theoretical Framework for Acoustic Neighbor Embeddings","version":1},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-11T23:52:36.631797Z"},"links":{"citing_paper":"/paper/2412.02164"},"observation_digest":"sha256:308f140ae5ce7ac7dbfc1eafa3e8db0f4191ce8b3a6d913a70ca611944fb390c","observation_id":"6c859e2b-b47e-479a-94c7-072a18b7d764","resolution":{"observed_at":"2026-08-11T23:52:36.631797Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"5508.34555","doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T23:52:37.005004Z","title":"Phonetic confusion matrix based spoken document retrieval,","venue":null,"work_id":"4f4a1a4f-4ca8-41f4-847d-862bafcab975","year":2000},"citing_paper":{"arxiv_id":"2412.02164","last_updated":"2024-12-03T04:48:59Z","snapshot_observed_at":"2026-08-14T22:10:18.153994Z","submitted_at":"2024-12-03T04:48:59Z","title":"A Theoretical Framework for Acoustic Neighbor Embeddings","version":1},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-08-11T23:52:36.636637Z"},"links":{"citing_paper":"/paper/2412.02164"},"observation_digest":"sha256:8419ebbbef3749cfbfe57280d093c66ef659fd3ebd67cb37a4503f878a885228","observation_id":"e0f3d21b-f857-4073-b1ab-fb512821e0d6","resolution":{"observed_at":"2026-08-11T23:52:37.015291Z","resolver_source":"raw_fallback","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T23:52:37.557958Z","title":"Comparison of parametric representations for monosyllabic word recognition in continuously spoken sentences,","venue":null,"work_id":"1137b19d-d7f8-48a0-89a3-2ba0fb912485","year":1980},"citing_paper":{"arxiv_id":"2412.02164","last_updated":"2024-12-03T04:48:59Z","snapshot_observed_at":"2026-08-14T22:10:18.153994Z","submitted_at":"2024-12-03T04:48:59Z","title":"A Theoretical Framework for Acoustic Neighbor Embeddings","version":1},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-08-11T23:52:36.641225Z"},"links":{"citing_paper":"/paper/2412.02164"},"observation_digest":"sha256:b6371ba08b47c496c8a4b1a4a6883c4987de3fb19c65c3cdc7c5ce996dbdb69f","observation_id":"d91d41b4-3912-48ac-9fcb-535e6af8c1be","resolution":{"observed_at":"2026-08-11T23:52:37.563568Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T23:52:37.541772Z","title":"Query-by-example spoken term detection using phonetic posteriorgram templates,","venue":null,"work_id":"c2dc215c-7c0a-412d-b4b6-e375caf8081b","year":2009},"citing_paper":{"arxiv_id":"2412.02164","last_updated":"2024-12-03T04:48:59Z","snapshot_observed_at":"2026-08-14T22:10:18.153994Z","submitted_at":"2024-12-03T04:48:59Z","title":"A Theoretical Framework for Acoustic Neighbor Embeddings","version":1},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-08-11T23:52:36.645983Z"},"links":{"citing_paper":"/paper/2412.02164"},"observation_digest":"sha256:d05f9c3cb69c3376de5911e2cbbd4e47cb6a65388d5120d6594f370d446abed8","observation_id":"27a96e3d-4a45-4592-8b4d-b1d57b52655f","resolution":{"observed_at":"2026-08-11T23:52:37.546735Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T23:52:36.651053Z","title":"Approximate nearest neighbors: towards removing the curse of dimensionality,","venue":null,"work_id":null,"year":1998},"citing_paper":{"arxiv_id":"2412.02164","last_updated":"2024-12-03T04:48:59Z","snapshot_observed_at":"2026-08-14T22:10:18.153994Z","submitted_at":"2024-12-03T04:48:59Z","title":"A Theoretical Framework for Acoustic Neighbor Embeddings","version":1},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-08-11T23:52:36.651053Z"},"links":{"citing_paper":"/paper/2412.02164"},"observation_digest":"sha256:a01a605e2ad5c2c0a78c5db946432453b530a29aea43d6f070e03c2236c8b472","observation_id":"e9888fb4-eb80-49c9-b329-8cf8feab246f","resolution":{"observed_at":"2026-08-11T23:52:36.651053Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T23:52:37.526189Z","title":"Fast k nearest neighbor search using gpu,","venue":null,"work_id":"8c2f867c-979a-4a2b-a8f8-f14a1e8b1d68","year":2008},"citing_paper":{"arxiv_id":"2412.02164","last_updated":"2024-12-03T04:48:59Z","snapshot_observed_at":"2026-08-14T22:10:18.153994Z","submitted_at":"2024-12-03T04:48:59Z","title":"A Theoretical Framework for Acoustic Neighbor Embeddings","version":1},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-08-11T23:52:36.655807Z"},"links":{"citing_paper":"/paper/2412.02164"},"observation_digest":"sha256:cdafc11468c35a75651616f72542896dce4ee9ca1cdba9398928b7fa6ba201a4","observation_id":"b50770be-2dba-4bd4-8f24-845848250a64","resolution":{"observed_at":"2026-08-11T23:52:37.531159Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T23:52:37.510561Z","title":"Soar: improved indexing for approximate nearest neighbor search,","venue":null,"work_id":"a7a9e88f-4232-4b8c-bb1e-5a3cebb28213","year":2024},"citing_paper":{"arxiv_id":"2412.02164","last_updated":"2024-12-03T04:48:59Z","snapshot_observed_at":"2026-08-14T22:10:18.153994Z","submitted_at":"2024-12-03T04:48:59Z","title":"A Theoretical Framework for Acoustic Neighbor Embeddings","version":1},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-08-11T23:52:36.660615Z"},"links":{"citing_paper":"/paper/2412.02164"},"observation_digest":"sha256:7c438566e4dcc462c69822020e19e3e1b706eaafc5a7c385406067d8a7d4fffd","observation_id":"74e1d5fa-6026-45ed-a12e-508dac367d4e","resolution":{"observed_at":"2026-08-11T23:52:37.515599Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T23:52:37.494852Z","title":"Isotropy, clusters, and classifiers,","venue":null,"work_id":"43f60530-145d-41b2-9e48-7256be15705b","year":2024},"citing_paper":{"arxiv_id":"2412.02164","last_updated":"2024-12-03T04:48:59Z","snapshot_observed_at":"2026-08-14T22:10:18.153994Z","submitted_at":"2024-12-03T04:48:59Z","title":"A Theoretical Framework for Acoustic Neighbor Embeddings","version":1},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-08-11T23:52:36.665386Z"},"links":{"citing_paper":"/paper/2412.02164"},"observation_digest":"sha256:bcc5b00a29010cb150fd8d8fecef32bdfe91929ec055f83fcb22fb7380fb29e4","observation_id":"d6809453-8cbc-4a49-984b-f0a5cf284003","resolution":{"observed_at":"2026-08-11T23:52:37.499705Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T23:52:37.479130Z","title":"The kaldi speech recognition toolkit,","venue":null,"work_id":"5a5423ff-5628-4f1e-9722-48dd08bd42be","year":2011},"citing_paper":{"arxiv_id":"2412.02164","last_updated":"2024-12-03T04:48:59Z","snapshot_observed_at":"2026-08-14T22:10:18.153994Z","submitted_at":"2024-12-03T04:48:59Z","title":"A Theoretical Framework for Acoustic Neighbor Embeddings","version":1},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-08-11T23:52:36.670128Z"},"links":{"citing_paper":"/paper/2412.02164"},"observation_digest":"sha256:486c6de2881c630a21c6d544b4aa38dfde48989781e9c2905f974eaf77fd08de","observation_id":"09189140-f7e8-46b3-8695-77fa6fb8b9e1","resolution":{"observed_at":"2026-08-11T23:52:37.483921Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T23:52:36.674981Z","title":"Paszke, S","venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2412.02164","last_updated":"2024-12-03T04:48:59Z","snapshot_observed_at":"2026-08-14T22:10:18.153994Z","submitted_at":"2024-12-03T04:48:59Z","title":"A Theoretical Framework for Acoustic Neighbor Embeddings","version":1},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-08-11T23:52:36.674981Z"},"links":{"citing_paper":"/paper/2412.02164"},"observation_digest":"sha256:f9afcf21f0be68d97e7e00713b684421c1acd68067d65556c5caad41aea56044","observation_id":"66b4722e-14af-45d5-8a54-7a4470b2760c","resolution":{"observed_at":"2026-08-11T23:52:36.674981Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T23:52:37.450513Z","title":"The CMU Pronouncing Dictionary,","venue":null,"work_id":"5aeae121-6184-4956-9ee0-42a7c25cb6db","year":null},"citing_paper":{"arxiv_id":"2412.02164","last_updated":"2024-12-03T04:48:59Z","snapshot_observed_at":"2026-08-14T22:10:18.153994Z","submitted_at":"2024-12-03T04:48:59Z","title":"A Theoretical Framework for Acoustic Neighbor Embeddings","version":1},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-08-11T23:52:36.679731Z"},"links":{"citing_paper":"/paper/2412.02164"},"observation_digest":"sha256:69a211d3f2fb1d39f79100fadf28d8cc834bdf1a83657a0460bafe8661e8efb1","observation_id":"5f5bb6ba-329f-452b-88b3-dbb29e5ccce2","resolution":{"observed_at":"2026-08-11T23:52:37.456567Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T23:52:36.684548Z","title":"Librispeech: An ASR corpus based on public domain audio books,","venue":null,"work_id":null,"year":2015},"citing_paper":{"arxiv_id":"2412.02164","last_updated":"2024-12-03T04:48:59Z","snapshot_observed_at":"2026-08-14T22:10:18.153994Z","submitted_at":"2024-12-03T04:48:59Z","title":"A Theoretical Framework for Acoustic Neighbor Embeddings","version":1},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-08-11T23:52:36.684548Z"},"links":{"citing_paper":"/paper/2412.02164"},"observation_digest":"sha256:4a63d42db99a31cf7f53ded0039e1d0e722a3f7e0a741787ee37fd7cf8b3390b","observation_id":"4945e593-96c4-4f3f-88fe-24031bb8c7ba","resolution":{"observed_at":"2026-08-11T23:52:36.684548Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T23:52:37.423834Z","title":"Librispeech language models, vocabulary and G2P models,","venue":null,"work_id":"9f9d3a92-56b1-4c46-bbb0-d22f09c4cbd9","year":2024},"citing_paper":{"arxiv_id":"2412.02164","last_updated":"2024-12-03T04:48:59Z","snapshot_observed_at":"2026-08-14T22:10:18.153994Z","submitted_at":"2024-12-03T04:48:59Z","title":"A Theoretical Framework for Acoustic Neighbor Embeddings","version":1},"reference_index":36,"source":"pdf_text","source_observed_at":"2026-08-11T23:52:36.689594Z"},"links":{"citing_paper":"/paper/2412.02164"},"observation_digest":"sha256:49075f45f7307cf5724be383589bdc41fbd08960299cc4e43927e99c6bd2c030","observation_id":"50f37b09-f190-4529-bb57-c2cd0405926e","resolution":{"observed_at":"2026-08-11T23:52:37.428995Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T23:52:36.694469Z","title":"Conformer: Convolution- augmented Transformer for Speech Recognition,","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2412.02164","last_updated":"2024-12-03T04:48:59Z","snapshot_observed_at":"2026-08-14T22:10:18.153994Z","submitted_at":"2024-12-03T04:48:59Z","title":"A Theoretical Framework for Acoustic Neighbor Embeddings","version":1},"reference_index":37,"source":"pdf_text","source_observed_at":"2026-08-11T23:52:36.694469Z"},"links":{"citing_paper":"/paper/2412.02164"},"observation_digest":"sha256:654298845e4838c1593fea0c962a8c92de3dcdecf9366a32409590c9c24c7886","observation_id":"b9e49f12-5fc9-417d-95c9-46b7050f3526","resolution":{"observed_at":"2026-08-11T23:52:36.694469Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T23:52:37.398719Z","title":"Bourlard and N","venue":null,"work_id":"c358947e-8934-4b63-ad56-6007b9a5df4b","year":1994},"citing_paper":{"arxiv_id":"2412.02164","last_updated":"2024-12-03T04:48:59Z","snapshot_observed_at":"2026-08-14T22:10:18.153994Z","submitted_at":"2024-12-03T04:48:59Z","title":"A Theoretical Framework for Acoustic Neighbor Embeddings","version":1},"reference_index":38,"source":"pdf_text","source_observed_at":"2026-08-11T23:52:36.699124Z"},"links":{"citing_paper":"/paper/2412.02164"},"observation_digest":"sha256:7dea96333ef19e0b91162abc19c185f3ac06b53d08aacb339fc2c144f5868c16","observation_id":"13998a7a-3916-432c-bcb2-aaa22f225bea","resolution":{"observed_at":"2026-08-11T23:52:37.403549Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T23:52:36.703871Z","title":"Adam: A method for stochastic optimization,","venue":null,"work_id":null,"year":2015},"citing_paper":{"arxiv_id":"2412.02164","last_updated":"2024-12-03T04:48:59Z","snapshot_observed_at":"2026-08-14T22:10:18.153994Z","submitted_at":"2024-12-03T04:48:59Z","title":"A Theoretical Framework for Acoustic Neighbor Embeddings","version":1},"reference_index":39,"source":"pdf_text","source_observed_at":"2026-08-11T23:52:36.703871Z"},"links":{"citing_paper":"/paper/2412.02164"},"observation_digest":"sha256:07b21d28be0a256c56dac163ee7a8534814019412cf3717a4bd92ef91f76451a","observation_id":"ee3a65f9-ae49-4a74-98e3-43ed2e7f5b7a","resolution":{"observed_at":"2026-08-11T23:52:36.703871Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T23:52:37.372989Z","title":"Contextual Recovery of Out-of-Lattice Named Entities in Automatic Speech Recog- nition,","venue":null,"work_id":"f45f3c3a-3612-4ad1-b201-49986a103b54","year":2019},"citing_paper":{"arxiv_id":"2412.02164","last_updated":"2024-12-03T04:48:59Z","snapshot_observed_at":"2026-08-14T22:10:18.153994Z","submitted_at":"2024-12-03T04:48:59Z","title":"A Theoretical Framework for Acoustic Neighbor Embeddings","version":1},"reference_index":40,"source":"pdf_text","source_observed_at":"2026-08-11T23:52:36.708660Z"},"links":{"citing_paper":"/paper/2412.02164"},"observation_digest":"sha256:4d5c4c6b2c4e1b6897121dee053fbd491ffeabef901ee62b23807562f1fc4860","observation_id":"12ae23da-006d-4aa7-bd3d-e904434b4cd5","resolution":{"observed_at":"2026-08-11T23:52:37.377821Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T23:52:37.357936Z","title":"Phonetic Embedding for ASR Robustness in Entity Resolution,","venue":null,"work_id":"ee55d6fd-4a1a-4514-83b1-a31e61d6972e","year":2022},"citing_paper":{"arxiv_id":"2412.02164","last_updated":"2024-12-03T04:48:59Z","snapshot_observed_at":"2026-08-14T22:10:18.153994Z","submitted_at":"2024-12-03T04:48:59Z","title":"A Theoretical Framework for Acoustic Neighbor Embeddings","version":1},"reference_index":41,"source":"pdf_text","source_observed_at":"2026-08-11T23:52:36.713372Z"},"links":{"citing_paper":"/paper/2412.02164"},"observation_digest":"sha256:c59985801bcdfea4d9b4d5cab17facbefd1a3c1f6e82cc7b690b22dad2d17993","observation_id":"f293368f-5a64-4b8e-bde6-e662bd11e41b","resolution":{"observed_at":"2026-08-11T23:52:37.362875Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T23:52:37.342242Z","title":"Computational dialectology in Irish Gaelic,","venue":null,"work_id":"c2117733-5e80-4ef1-9c38-ead07f3a41ab","year":null},"citing_paper":{"arxiv_id":"2412.02164","last_updated":"2024-12-03T04:48:59Z","snapshot_observed_at":"2026-08-14T22:10:18.153994Z","submitted_at":"2024-12-03T04:48:59Z","title":"A Theoretical Framework for Acoustic Neighbor Embeddings","version":1},"reference_index":42,"source":"pdf_text","source_observed_at":"2026-08-11T23:52:36.717965Z"},"links":{"citing_paper":"/paper/2412.02164"},"observation_digest":"sha256:9a1380fb517c0dbe2985d5f2dfa52913f85a3054e298a0f3451f9c37cc5fa720","observation_id":"f1409a86-b81f-476d-b93e-5f701242c7ed","resolution":{"observed_at":"2026-08-11T23:52:37.347765Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T23:52:37.310578Z","title":"Evaluation of acoustic word embeddings,","venue":null,"work_id":"80a58321-c750-431f-b5b9-a42547e62d9c","year":2016},"citing_paper":{"arxiv_id":"2412.02164","last_updated":"2024-12-03T04:48:59Z","snapshot_observed_at":"2026-08-14T22:10:18.153994Z","submitted_at":"2024-12-03T04:48:59Z","title":"A Theoretical Framework for Acoustic Neighbor Embeddings","version":1},"reference_index":43,"source":"pdf_text","source_observed_at":"2026-08-11T23:52:36.727916Z"},"links":{"citing_paper":"/paper/2412.02164"},"observation_digest":"sha256:90a70deec51195d7134b455b3d7441d71416c3189833602917ebedb2e5d4a086","observation_id":"ed7067dc-ed27-4f18-9f63-5c28d333ee14","resolution":{"observed_at":"2026-08-11T23:52:37.315628Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T23:52:37.294524Z","title":"Do Acoustic Word Embeddings Capture Phonological Similarity? An Empirical Study,","venue":null,"work_id":"6fea6f34-56d7-43e9-bc62-5d42b75edcec","year":2021},"citing_paper":{"arxiv_id":"2412.02164","last_updated":"2024-12-03T04:48:59Z","snapshot_observed_at":"2026-08-14T22:10:18.153994Z","submitted_at":"2024-12-03T04:48:59Z","title":"A Theoretical Framework for Acoustic Neighbor Embeddings","version":1},"reference_index":44,"source":"pdf_text","source_observed_at":"2026-08-11T23:52:36.732795Z"},"links":{"citing_paper":"/paper/2412.02164"},"observation_digest":"sha256:3f63e2f2370bcd4de3da0b7c75bf0172eaf7f4c74048627c85592880ad052780","observation_id":"e7392e12-896c-4590-adeb-7dacaad581a5","resolution":{"observed_at":"2026-08-11T23:52:37.299695Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T23:52:37.278904Z","title":"Keyword search using modified minimum edit distance measure,","venue":null,"work_id":"ff9f40f7-4df8-44e7-b8af-1ce1a2c169cd","year":2007},"citing_paper":{"arxiv_id":"2412.02164","last_updated":"2024-12-03T04:48:59Z","snapshot_observed_at":"2026-08-14T22:10:18.153994Z","submitted_at":"2024-12-03T04:48:59Z","title":"A Theoretical Framework for Acoustic Neighbor Embeddings","version":1},"reference_index":45,"source":"pdf_text","source_observed_at":"2026-08-11T23:52:36.737588Z"},"links":{"citing_paper":"/paper/2412.02164"},"observation_digest":"sha256:e98ed0e90e9fb3f8376d710037d24acc7b9c62fca1f68bf327dc23a9362f282c","observation_id":"535cf6ae-e44c-4f81-bd27-5311c769f4aa","resolution":{"observed_at":"2026-08-11T23:52:37.283918Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T23:52:37.261388Z","title":"Coarticulation in recent speech production models,","venue":null,"work_id":"7135e46f-e529-472a-a08f-d54e81521a65","year":1977},"citing_paper":{"arxiv_id":"2412.02164","last_updated":"2024-12-03T04:48:59Z","snapshot_observed_at":"2026-08-14T22:10:18.153994Z","submitted_at":"2024-12-03T04:48:59Z","title":"A Theoretical Framework for Acoustic Neighbor Embeddings","version":1},"reference_index":46,"source":"pdf_text","source_observed_at":"2026-08-11T23:52:36.742033Z"},"links":{"citing_paper":"/paper/2412.02164"},"observation_digest":"sha256:fc34c4c436ada544140b3f4bc5fc63ecf580e72ca1658c0c03f177bd1a10f51f","observation_id":"0a1a3e04-db13-482a-9547-6f70246e00b0","resolution":{"observed_at":"2026-08-11T23:52:37.268106Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T23:52:37.244641Z","title":"ADDTREE/P: A pascal program for fitting additive trees based on Sattath and Tversky’s ADDTREE algorithm","venue":null,"work_id":"7581cd51-821f-4fd2-931d-f28332f1e88c","year":1982},"citing_paper":{"arxiv_id":"2412.02164","last_updated":"2024-12-03T04:48:59Z","snapshot_observed_at":"2026-08-14T22:10:18.153994Z","submitted_at":"2024-12-03T04:48:59Z","title":"A Theoretical Framework for Acoustic Neighbor Embeddings","version":1},"reference_index":47,"source":"pdf_text","source_observed_at":"2026-08-11T23:52:36.746630Z"},"links":{"citing_paper":"/paper/2412.02164"},"observation_digest":"sha256:8608b81aceadcb9c20ceb3efb7c6a8e58bfd7ca8452965119f36ef23ea8d52eb","observation_id":"b733605f-30ec-4fc2-a5e6-043fd71f06eb","resolution":{"observed_at":"2026-08-11T23:52:37.249895Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T23:52:37.228291Z","title":"Some acoustic cues for the perceptual categorization of american english regional dialects,","venue":null,"work_id":"7ec384d1-c144-4087-816c-1b902eec9f02","year":2004},"citing_paper":{"arxiv_id":"2412.02164","last_updated":"2024-12-03T04:48:59Z","snapshot_observed_at":"2026-08-14T22:10:18.153994Z","submitted_at":"2024-12-03T04:48:59Z","title":"A Theoretical Framework for Acoustic Neighbor Embeddings","version":1},"reference_index":48,"source":"pdf_text","source_observed_at":"2026-08-11T23:52:36.751266Z"},"links":{"citing_paper":"/paper/2412.02164"},"observation_digest":"sha256:b973282ee611e991803abbaac30a97bb9a7cb42ca919e6ea270637bfca1eedec","observation_id":"009ac071-363f-410b-a077-d722ac2f624b","resolution":{"observed_at":"2026-08-11T23:52:37.233630Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T23:52:37.212220Z","title":"TIMIT acoustic-phonetic continuous speech corpus,","venue":null,"work_id":"4f427a22-dafa-4ed3-ac4b-7772fed01507","year":1992},"citing_paper":{"arxiv_id":"2412.02164","last_updated":"2024-12-03T04:48:59Z","snapshot_observed_at":"2026-08-14T22:10:18.153994Z","submitted_at":"2024-12-03T04:48:59Z","title":"A Theoretical Framework for Acoustic Neighbor Embeddings","version":1},"reference_index":49,"source":"pdf_text","source_observed_at":"2026-08-11T23:52:36.756189Z"},"links":{"citing_paper":"/paper/2412.02164"},"observation_digest":"sha256:9d84cea8c2f2e64a2d4ebc57ed6d73af27f8a8a53f36bc4de3330cc93493b3b1","observation_id":"142e6680-50f7-4a5a-9b2f-9004cbfa2cf1","resolution":{"observed_at":"2026-08-11T23:52:37.217488Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T23:52:37.196642Z","title":"ADDTREE/P version 1.5,","venue":null,"work_id":"865f70d7-dbcd-490f-aa70-ac8f7de80731","year":2024},"citing_paper":{"arxiv_id":"2412.02164","last_updated":"2024-12-03T04:48:59Z","snapshot_observed_at":"2026-08-14T22:10:18.153994Z","submitted_at":"2024-12-03T04:48:59Z","title":"A Theoretical Framework for Acoustic Neighbor Embeddings","version":1},"reference_index":50,"source":"pdf_text","source_observed_at":"2026-08-11T23:52:36.760747Z"},"links":{"citing_paper":"/paper/2412.02164"},"observation_digest":"sha256:05e2986aad17f195289a1fc7e383cb90a5dd0fe565ed3f82cded78728a386a47","observation_id":"15aa9e90-4783-4136-b803-07c89b1d148e","resolution":{"observed_at":"2026-08-11T23:52:37.201540Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T23:52:37.178322Z","title":"Hey siri: An on-device DNN-powered voice trigger for apple’s per- sonal assistant,","venue":null,"work_id":"5bdc1652-8acf-41fb-a005-65bf77ba55b2","year":2024},"citing_paper":{"arxiv_id":"2412.02164","last_updated":"2024-12-03T04:48:59Z","snapshot_observed_at":"2026-08-14T22:10:18.153994Z","submitted_at":"2024-12-03T04:48:59Z","title":"A Theoretical Framework for Acoustic Neighbor Embeddings","version":1},"reference_index":51,"source":"pdf_text","source_observed_at":"2026-08-11T23:52:36.765570Z"},"links":{"citing_paper":"/paper/2412.02164"},"observation_digest":"sha256:ef44e55e0a3acf2f30ac88016cba2bd7b88e8616bd6c689dff723ea6f28d6ca5","observation_id":"20708201-1ecb-438d-8bb1-9e2785b3ae6c","resolution":{"observed_at":"2026-08-11T23:52:37.184442Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T23:52:37.161854Z","title":"Exploring accidental triggers of smart speakers,","venue":null,"work_id":"572fb3eb-6ba0-4f2b-add8-48e116f71564","year":2022},"citing_paper":{"arxiv_id":"2412.02164","last_updated":"2024-12-03T04:48:59Z","snapshot_observed_at":"2026-08-14T22:10:18.153994Z","submitted_at":"2024-12-03T04:48:59Z","title":"A Theoretical Framework for Acoustic Neighbor Embeddings","version":1},"reference_index":52,"source":"pdf_text","source_observed_at":"2026-08-11T23:52:36.770048Z"},"links":{"citing_paper":"/paper/2412.02164"},"observation_digest":"sha256:7a76245e1d277a33d9a6c39d01c1cadc57adca8eaa89741a5f29088a6c28709e","observation_id":"6ea3d6f6-6342-4e5a-821e-3715f7a95ada","resolution":{"observed_at":"2026-08-11T23:52:37.166943Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T23:52:37.145573Z","title":"Generating TTS Based Adversarial Samples for Training Wake-Up Word Detection Systems Against Confusing Words,","venue":null,"work_id":"addc4657-02f8-46ab-a367-d95655d39c16","year":2022},"citing_paper":{"arxiv_id":"2412.02164","last_updated":"2024-12-03T04:48:59Z","snapshot_observed_at":"2026-08-14T22:10:18.153994Z","submitted_at":"2024-12-03T04:48:59Z","title":"A Theoretical Framework for Acoustic Neighbor Embeddings","version":1},"reference_index":53,"source":"pdf_text","source_observed_at":"2026-08-11T23:52:36.774731Z"},"links":{"citing_paper":"/paper/2412.02164"},"observation_digest":"sha256:5766cd58c474028aa4fc52854d5b2ce7907baf27512f30af9c8a82e12a59ed67","observation_id":"6ae75610-b913-42e0-9df5-7d5c82fefb2a","resolution":{"observed_at":"2026-08-11T23:52:37.150895Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1706.03762","last_updated":"2023-08-02T00:41:18Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2017-06-12T17:57:34Z","title":"Attention Is All You Need","version":7},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1706.03762","snapshot_observed_at":"2026-08-11T23:52:36.779532Z","title":"Attention is all you need,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2412.02164","last_updated":"2024-12-03T04:48:59Z","snapshot_observed_at":"2026-08-14T22:10:18.153994Z","submitted_at":"2024-12-03T04:48:59Z","title":"A Theoretical Framework for Acoustic Neighbor Embeddings","version":1},"reference_index":54,"source":"pdf_text","source_observed_at":"2026-08-11T23:52:36.779532Z"},"links":{"cited_paper":"/paper/1706.03762","citing_paper":"/paper/2412.02164"},"observation_digest":"sha256:585ac8bf6355537fb27f3037612835b6e172fb56e96bcd5e1f399ea9ce32a2bb","observation_id":"5da36a91-2707-4d71-9020-b9a09d291d01","resolution":{"observed_at":"2026-08-11T23:52:36.779532Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T23:52:37.128910Z","title":"IsoScore: Measuring the uniformity of embedding space utilization,","venue":null,"work_id":"72fb3ee8-9424-4727-88e6-ace110e41428","year":2022},"citing_paper":{"arxiv_id":"2412.02164","last_updated":"2024-12-03T04:48:59Z","snapshot_observed_at":"2026-08-14T22:10:18.153994Z","submitted_at":"2024-12-03T04:48:59Z","title":"A Theoretical Framework for Acoustic Neighbor Embeddings","version":1},"reference_index":55,"source":"pdf_text","source_observed_at":"2026-08-11T23:52:36.784619Z"},"links":{"citing_paper":"/paper/2412.02164"},"observation_digest":"sha256:d03c294fd0723806a095d251e95971728525f9bcccbb92da568df2436aec298b","observation_id":"e3c34b63-7ff4-4437-a0bd-565b41ad4862","resolution":{"observed_at":"2026-08-11T23:52:37.133960Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T23:52:37.112403Z","title":"Analyzing the representational geometry of acoustic word embeddings,","venue":null,"work_id":"a07d0268-25db-493c-9e6d-0cd8f2820201","year":2022},"citing_paper":{"arxiv_id":"2412.02164","last_updated":"2024-12-03T04:48:59Z","snapshot_observed_at":"2026-08-14T22:10:18.153994Z","submitted_at":"2024-12-03T04:48:59Z","title":"A Theoretical Framework for Acoustic Neighbor Embeddings","version":1},"reference_index":56,"source":"pdf_text","source_observed_at":"2026-08-11T23:52:36.789445Z"},"links":{"citing_paper":"/paper/2412.02164"},"observation_digest":"sha256:26d1913bcd015720f822d1ee4d00fe22aedaf5904f296feabefd6b7cdb18ed2b","observation_id":"4a1e47cd-900e-476d-b939-e1312376126f","resolution":{"observed_at":"2026-08-11T23:52:37.117586Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T23:52:37.326398Z","title":"Available: https://aclanthology.org/E95-1009","venue":null,"work_id":"4ff85aad-1585-4494-9af5-4a081256f299","year":null},"citing_paper":{"arxiv_id":"2412.02164","last_updated":"2024-12-03T04:48:59Z","snapshot_observed_at":"2026-08-14T22:10:18.153994Z","submitted_at":"2024-12-03T04:48:59Z","title":"A Theoretical Framework for Acoustic Neighbor Embeddings","version":1},"reference_index":1995,"source":"pdf_text","source_observed_at":"2026-08-11T23:52:36.722668Z"},"links":{"citing_paper":"/paper/2412.02164"},"observation_digest":"sha256:8340e25ffc56faf4dd9db55a82353941f8fe4759fd19a28267acf7b3b546e653","observation_id":"ed0cd0cd-24bd-42ab-b57d-401314e9e247","resolution":{"observed_at":"2026-08-11T23:52:37.331643Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}}],"paper":{"arxiv_id":"2412.02164","last_updated":"2024-12-03T04:48:59Z","latest_version":1,"primary_category":"eess.AS","snapshot_observed_at":"2026-08-14T22:10:18.153994Z","submitted_at":"2024-12-03T04:48:59Z","title":"A Theoretical Framework for Acoustic Neighbor Embeddings"},"reference_resolution":{"displayed":57,"state_counts":{"malformed_identifier":0,"metadata_mismatch":2,"parse_uncertain":0,"unresolved":10,"verified_exact":1,"verified_fuzzy":44},"total_outbound_references":57},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"thesis":"As of 15 August 2026, this Paper Citation Record lists 57 of 57 outbound references and 0 inbound Pith citation observations for arXiv:2412.02164."}