{"as_of":"2026-08-14T09:06:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:fa133f54c4ee6693a034bbaaa8aab7b4c302d31847f3f991379fe8cba61b6231","coverage":[{"denominator":28,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":28,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-10T21:27:46.608174Z","state":"measured"},{"denominator":28,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":28,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-14T06:32:32.682623+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2501.04844/citation-record","integrity":"/paper/2501.04844/integrity","json":"/paper/2501.04844/citation-record.json","paper":"/paper/2501.04844"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T21:27:46.976016Z","title":"A high-performance speech neuroprosthesis,","venue":null,"work_id":"ab801340-ec84-40cf-a6df-86bba0fb9984","year":2023},"citing_paper":{"arxiv_id":"2501.04844","last_updated":"2025-01-08T21:11:35Z","snapshot_observed_at":"2026-08-12T05:25:49.200696Z","submitted_at":"2025-01-08T21:11:35Z","title":"Enhancing Listened Speech Decoding from EEG via Parallel Phoneme Sequence Prediction","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-10T21:27:46.511049Z"},"links":{"citing_paper":"/paper/2501.04844"},"observation_digest":"sha256:6f762053762daa9c976539d93064424cc7d63207b2805d331655de43a2457fd4","observation_id":"8e17222f-7063-46c2-bcd5-d26f0f75c21f","resolution":{"observed_at":"2026-08-10T21:27:46.979755Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T21:27:46.965422Z","title":"A high-performance neuroprosthesis for speech decoding and avatar control,","venue":null,"work_id":"5baf3bc0-2caf-488c-862e-f0412ea25b90","year":2023},"citing_paper":{"arxiv_id":"2501.04844","last_updated":"2025-01-08T21:11:35Z","snapshot_observed_at":"2026-08-12T05:25:49.200696Z","submitted_at":"2025-01-08T21:11:35Z","title":"Enhancing Listened Speech Decoding from EEG via Parallel Phoneme Sequence Prediction","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-10T21:27:46.515207Z"},"links":{"citing_paper":"/paper/2501.04844"},"observation_digest":"sha256:55bbae488d0a2feefe8edf718c307bd1ed65e5806a6829025bb91b5efd3beb15","observation_id":"aa63089f-9d8c-45bf-a3b3-8b3bcff59a89","resolution":{"observed_at":"2026-08-10T21:27:46.969105Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T21:27:46.955183Z","title":"Relating eeg to continuous speech using deep neural networks: a review","venue":null,"work_id":"afa8506b-af54-4556-b1a5-fa8af530130f","year":2023},"citing_paper":{"arxiv_id":"2501.04844","last_updated":"2025-01-08T21:11:35Z","snapshot_observed_at":"2026-08-12T05:25:49.200696Z","submitted_at":"2025-01-08T21:11:35Z","title":"Enhancing Listened Speech Decoding from EEG via Parallel Phoneme Sequence Prediction","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-10T21:27:46.518611Z"},"links":{"citing_paper":"/paper/2501.04844"},"observation_digest":"sha256:5c918aab956690b3b83af727a112abed6afef600e78fa57c354a6e050274911f","observation_id":"2bb9c5e5-5482-44c8-aa52-5d3dbe4fb4d8","resolution":{"observed_at":"2026-08-10T21:27:46.958750Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T21:27:46.944917Z","title":"Knowledge- guided eeg representation learning,","venue":null,"work_id":"97af7e6a-d15b-4357-8712-089db3ddb14e","year":2024},"citing_paper":{"arxiv_id":"2501.04844","last_updated":"2025-01-08T21:11:35Z","snapshot_observed_at":"2026-08-12T05:25:49.200696Z","submitted_at":"2025-01-08T21:11:35Z","title":"Enhancing Listened Speech Decoding from EEG via Parallel Phoneme Sequence Prediction","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-10T21:27:46.522176Z"},"links":{"citing_paper":"/paper/2501.04844"},"observation_digest":"sha256:13a93879b0101da7ff688f9118b5f174a9f558149eefa241fb78e09552d339de","observation_id":"569346fd-cae2-45e0-b005-49be96a0bee0","resolution":{"observed_at":"2026-08-10T21:27:46.948731Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T21:27:46.933627Z","title":"Bendr: using transform- ers and a contrastive self-supervised learning task to learn from massive amounts of eeg data,","venue":null,"work_id":"15f105d8-b7df-4e51-9127-24558cd416c8","year":2021},"citing_paper":{"arxiv_id":"2501.04844","last_updated":"2025-01-08T21:11:35Z","snapshot_observed_at":"2026-08-12T05:25:49.200696Z","submitted_at":"2025-01-08T21:11:35Z","title":"Enhancing Listened Speech Decoding from EEG via Parallel Phoneme Sequence Prediction","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-10T21:27:46.526792Z"},"links":{"citing_paper":"/paper/2501.04844"},"observation_digest":"sha256:aea1cc512f95f6f6f100ccfaf4b5275ed7ba21c1697090d5d74a56f4d5b517d6","observation_id":"769f59f2-ebad-4379-9df2-535dbb60cb20","resolution":{"observed_at":"2026-08-10T21:27:46.937727Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T21:27:46.922704Z","title":"Maeeg: Masked auto-encoder for eeg representation learning,","venue":null,"work_id":"048a88ab-4541-4938-8cc3-c7dba00602d0","year":2022},"citing_paper":{"arxiv_id":"2501.04844","last_updated":"2025-01-08T21:11:35Z","snapshot_observed_at":"2026-08-12T05:25:49.200696Z","submitted_at":"2025-01-08T21:11:35Z","title":"Enhancing Listened Speech Decoding from EEG via Parallel Phoneme Sequence Prediction","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-10T21:27:46.530624Z"},"links":{"citing_paper":"/paper/2501.04844"},"observation_digest":"sha256:f65d253151e7fd2ff69d0a90e2be5a29b4abbf393154d0fb6468c31f142f4c90","observation_id":"8f581d9f-8549-4a5b-a888-76511391b736","resolution":{"observed_at":"2026-08-10T21:27:46.926692Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T21:27:46.911939Z","title":"Open vocabulary electroencephalography-to-text decoding and zero-shot sentiment classification,","venue":null,"work_id":"0cef6113-d9e9-4f2f-8c30-a4a03ff41bde","year":2022},"citing_paper":{"arxiv_id":"2501.04844","last_updated":"2025-01-08T21:11:35Z","snapshot_observed_at":"2026-08-12T05:25:49.200696Z","submitted_at":"2025-01-08T21:11:35Z","title":"Enhancing Listened Speech Decoding from EEG via Parallel Phoneme Sequence Prediction","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-10T21:27:46.534503Z"},"links":{"citing_paper":"/paper/2501.04844"},"observation_digest":"sha256:12f96756b6c4a5195a53dfc34c5823e3d48004f1c090f2199f5135d7e0c5fb41","observation_id":"76c10f48-e48e-41d0-b31c-01af0cd92ce1","resolution":{"observed_at":"2026-08-10T21:27:46.915777Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2405.02165","last_updated":"2024-05-03T15:14:19Z","snapshot_observed_at":"2026-08-13T00:15:19.419010Z","submitted_at":"2024-05-03T15:14:19Z","title":"EEG2TEXT: Open Vocabulary EEG-to-Text Decoding with EEG Pre-Training and Multi-View Transformer","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2405.02165","snapshot_observed_at":"2026-08-10T21:27:46.538279Z","title":"Eeg2text: Open vocabulary eeg-to-text decoding with eeg pre-training and multi- view transformer,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2501.04844","last_updated":"2025-01-08T21:11:35Z","snapshot_observed_at":"2026-08-12T05:25:49.200696Z","submitted_at":"2025-01-08T21:11:35Z","title":"Enhancing Listened Speech Decoding from EEG via Parallel Phoneme Sequence Prediction","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-10T21:27:46.538279Z"},"links":{"cited_paper":"/paper/2405.02165","citing_paper":"/paper/2501.04844"},"observation_digest":"sha256:d58f053e7430306e5049e748f843b23bc341eac018cc9244bb9c7259f5a8cc9a","observation_id":"4df03a52-8997-402c-9ed3-01717e6b25f0","resolution":{"observed_at":"2026-08-10T21:27:46.538279Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T21:27:46.901111Z","title":"Dewave: Discrete encoding of eeg waves for eeg to text translation,","venue":null,"work_id":"e97fb05f-3811-4f31-b415-af57423edc83","year":2024},"citing_paper":{"arxiv_id":"2501.04844","last_updated":"2025-01-08T21:11:35Z","snapshot_observed_at":"2026-08-12T05:25:49.200696Z","submitted_at":"2025-01-08T21:11:35Z","title":"Enhancing Listened Speech Decoding from EEG via Parallel Phoneme Sequence Prediction","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-10T21:27:46.542149Z"},"links":{"citing_paper":"/paper/2501.04844"},"observation_digest":"sha256:af07317b9de5c9f774083b4a448edd386956c77c597410f38c6c6e6d79ad86ff","observation_id":"a2988576-8403-45df-9616-f1dd3d2619f8","resolution":{"observed_at":"2026-08-10T21:27:46.905098Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T21:27:46.890824Z","title":"Decoding of the speech envelope from eeg using the vlaai deep neural network,","venue":null,"work_id":"1fdfe815-b5ec-4a3a-8103-b8e72dcf1976","year":2023},"citing_paper":{"arxiv_id":"2501.04844","last_updated":"2025-01-08T21:11:35Z","snapshot_observed_at":"2026-08-12T05:25:49.200696Z","submitted_at":"2025-01-08T21:11:35Z","title":"Enhancing Listened Speech Decoding from EEG via Parallel Phoneme Sequence Prediction","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-10T21:27:46.545246Z"},"links":{"citing_paper":"/paper/2501.04844"},"observation_digest":"sha256:162c031b447652010d7b3cc2337a6dbe13474b16cae6ca5394914067c76fb038","observation_id":"99980010-539e-4047-8ef7-e12e2ef1b000","resolution":{"observed_at":"2026-08-10T21:27:46.894390Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2401.04965","last_updated":"2024-01-10T07:15:45Z","snapshot_observed_at":"2026-08-13T04:45:30.837191Z","submitted_at":"2024-01-10T07:15:45Z","title":"ConvConcatNet: a deep convolutional neural network to reconstruct mel spectrogram from the EEG","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2401.04965","snapshot_observed_at":"2026-08-10T21:27:46.548155Z","title":"Convconcatnet: a deep convolutional neural network to reconstruct mel spectrogram from the eeg,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2501.04844","last_updated":"2025-01-08T21:11:35Z","snapshot_observed_at":"2026-08-12T05:25:49.200696Z","submitted_at":"2025-01-08T21:11:35Z","title":"Enhancing Listened Speech Decoding from EEG via Parallel Phoneme Sequence Prediction","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-10T21:27:46.548155Z"},"links":{"cited_paper":"/paper/2401.04965","citing_paper":"/paper/2501.04844"},"observation_digest":"sha256:94bc80247102c65ba20924e2c09d907bbd4bbd3a633c25d5fd0575679ad1f8d6","observation_id":"55777bd7-348f-4d4a-96ab-1aa89dfec321","resolution":{"observed_at":"2026-08-10T21:27:46.548155Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T21:27:46.880528Z","title":"Using articulated speech eeg signals for imagined speech decoding,","venue":null,"work_id":"f0d07695-a78d-432a-bff5-0ba153fac6cc","year":2024},"citing_paper":{"arxiv_id":"2501.04844","last_updated":"2025-01-08T21:11:35Z","snapshot_observed_at":"2026-08-12T05:25:49.200696Z","submitted_at":"2025-01-08T21:11:35Z","title":"Enhancing Listened Speech Decoding from EEG via Parallel Phoneme Sequence Prediction","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-10T21:27:46.551344Z"},"links":{"citing_paper":"/paper/2501.04844"},"observation_digest":"sha256:cea54088f2c31becb7ec3f71cb76302270f1594fdab14f6fe10863f7d5f01d4d","observation_id":"bcffa13f-2b24-42ca-a885-68ec1dd1e7a0","resolution":{"observed_at":"2026-08-10T21:27:46.884048Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T21:27:46.870407Z","title":"De- coding speech perception from non-invasive brain recordings,","venue":null,"work_id":"31857aa6-e611-4c04-a06b-1709980226f1","year":2023},"citing_paper":{"arxiv_id":"2501.04844","last_updated":"2025-01-08T21:11:35Z","snapshot_observed_at":"2026-08-12T05:25:49.200696Z","submitted_at":"2025-01-08T21:11:35Z","title":"Enhancing Listened Speech Decoding from EEG via Parallel Phoneme Sequence Prediction","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-10T21:27:46.554372Z"},"links":{"citing_paper":"/paper/2501.04844"},"observation_digest":"sha256:73fbe9ab71f852522df2ebc5911daf154210d36db5ed763a40c103cf372fdd52","observation_id":"09861a45-f0ff-40ad-a7a1-20238e73424b","resolution":{"observed_at":"2026-08-10T21:27:46.873828Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T21:27:46.859642Z","title":"WaveNet: A Generative Model for Raw Audio,","venue":null,"work_id":"acd31e6a-38b9-4eac-b869-602957e0e206","year":2016},"citing_paper":{"arxiv_id":"2501.04844","last_updated":"2025-01-08T21:11:35Z","snapshot_observed_at":"2026-08-12T05:25:49.200696Z","submitted_at":"2025-01-08T21:11:35Z","title":"Enhancing Listened Speech Decoding from EEG via Parallel Phoneme Sequence Prediction","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-10T21:27:46.557558Z"},"links":{"citing_paper":"/paper/2501.04844"},"observation_digest":"sha256:4c9e9a8373492a02c51d170875c3bfb85df36a57094a8f9abdebc0d1a12819b4","observation_id":"d5353e0c-41ab-4708-9854-00b2a09e6a2a","resolution":{"observed_at":"2026-08-10T21:27:46.864032Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T21:27:46.849112Z","title":"Cross-attention-guided wavenet for mel spectrogram reconstruction in the icassp 2024 auditory eeg challenge,","venue":null,"work_id":"747b09d4-8e8b-4191-bcde-91eeec4b7a6e","year":2024},"citing_paper":{"arxiv_id":"2501.04844","last_updated":"2025-01-08T21:11:35Z","snapshot_observed_at":"2026-08-12T05:25:49.200696Z","submitted_at":"2025-01-08T21:11:35Z","title":"Enhancing Listened Speech Decoding from EEG via Parallel Phoneme Sequence Prediction","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-10T21:27:46.560799Z"},"links":{"citing_paper":"/paper/2501.04844"},"observation_digest":"sha256:4390af5e332f65243f822da86072cbb06ef1ff118477b47bfbc7e116ddb42e35","observation_id":"0b07b4a5-9904-4f0f-9125-07c4cf882434","resolution":{"observed_at":"2026-08-10T21:27:46.853130Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T21:27:46.837018Z","title":"Toward fully-end-to-end listened speech decoding from eeg signals,","venue":null,"work_id":"a4c7f959-8b92-4b54-a0e6-df55b66d02c9","year":2024},"citing_paper":{"arxiv_id":"2501.04844","last_updated":"2025-01-08T21:11:35Z","snapshot_observed_at":"2026-08-12T05:25:49.200696Z","submitted_at":"2025-01-08T21:11:35Z","title":"Enhancing Listened Speech Decoding from EEG via Parallel Phoneme Sequence Prediction","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-10T21:27:46.563766Z"},"links":{"citing_paper":"/paper/2501.04844"},"observation_digest":"sha256:350632810a5bbea3bf07a82ad2d0c91ca7ff9f0d1da84061f213fcdd1b61b230","observation_id":"82e18950-ee97-4502-bd51-a4570e00be8d","resolution":{"observed_at":"2026-08-10T21:27:46.841156Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T21:27:46.823832Z","title":"Efficiently modeling long sequences with structured state spaces,","venue":null,"work_id":"e7d5cbbd-3c65-4b56-85ee-749ae6f4daec","year":2021},"citing_paper":{"arxiv_id":"2501.04844","last_updated":"2025-01-08T21:11:35Z","snapshot_observed_at":"2026-08-12T05:25:49.200696Z","submitted_at":"2025-01-08T21:11:35Z","title":"Enhancing Listened Speech Decoding from EEG via Parallel Phoneme Sequence Prediction","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-10T21:27:46.567070Z"},"links":{"citing_paper":"/paper/2501.04844"},"observation_digest":"sha256:51f9c8204f7e139112fa888d4c60340f65fd923a45e91b5b9efde9d9d075191d","observation_id":"443dea34-c94c-43c3-be27-6a215b814515","resolution":{"observed_at":"2026-08-10T21:27:46.828464Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T21:27:46.570591Z","title":"Conditional variational autoencoder with adversarial learning for end-to-end text-to-speech,","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2501.04844","last_updated":"2025-01-08T21:11:35Z","snapshot_observed_at":"2026-08-12T05:25:49.200696Z","submitted_at":"2025-01-08T21:11:35Z","title":"Enhancing Listened Speech Decoding from EEG via Parallel Phoneme Sequence Prediction","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-10T21:27:46.570591Z"},"links":{"citing_paper":"/paper/2501.04844"},"observation_digest":"sha256:90fc779e021710df115125f669b291f80ba477c99ba95d1a9c91b201e7ce48a7","observation_id":"e82cefa8-d8a2-45eb-8b37-aaca111d0350","resolution":{"observed_at":"2026-08-10T21:27:46.570591Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T21:27:46.574050Z","title":"Hifi-gan: Generative adversarial networks for efficient and high fidelity speech synthesis,","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2501.04844","last_updated":"2025-01-08T21:11:35Z","snapshot_observed_at":"2026-08-12T05:25:49.200696Z","submitted_at":"2025-01-08T21:11:35Z","title":"Enhancing Listened Speech Decoding from EEG via Parallel Phoneme Sequence Prediction","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-10T21:27:46.574050Z"},"links":{"citing_paper":"/paper/2501.04844"},"observation_digest":"sha256:a4e6356e78410b3de07fcd92696457ef5e09534c885dc3091c675f6c101b2326","observation_id":"83b8d206-5ada-4f9b-b482-8f598bfb603d","resolution":{"observed_at":"2026-08-10T21:27:46.574050Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T21:27:46.577683Z","title":"Attention is all you need,","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2501.04844","last_updated":"2025-01-08T21:11:35Z","snapshot_observed_at":"2026-08-12T05:25:49.200696Z","submitted_at":"2025-01-08T21:11:35Z","title":"Enhancing Listened Speech Decoding from EEG via Parallel Phoneme Sequence Prediction","version":1},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-10T21:27:46.577683Z"},"links":{"citing_paper":"/paper/2501.04844"},"observation_digest":"sha256:18009667c3be31695d96d92b332d5fc7c8a82a87b535732154b26897cbba180e","observation_id":"da2439d5-520c-48bb-8f72-a4f87c937a5e","resolution":{"observed_at":"2026-08-10T21:27:46.577683Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T21:27:46.581806Z","title":"Density estimation using real NVP,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2501.04844","last_updated":"2025-01-08T21:11:35Z","snapshot_observed_at":"2026-08-12T05:25:49.200696Z","submitted_at":"2025-01-08T21:11:35Z","title":"Enhancing Listened Speech Decoding from EEG via Parallel Phoneme Sequence Prediction","version":1},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-10T21:27:46.581806Z"},"links":{"citing_paper":"/paper/2501.04844"},"observation_digest":"sha256:ae92a4fc55589b6fb9e9a22597387fd87460d96148ac1c1c78097f7bd7204a3b","observation_id":"45c6a491-6ee7-40c6-8bcf-8e88d93a0cba","resolution":{"observed_at":"2026-08-10T21:27:46.581806Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T21:27:46.779992Z","title":"Conformer: Convolution- augmented Transformer for Speech Recognition,","venue":null,"work_id":"e1b12be0-2660-49b1-a3ad-b2b5e1f52e5b","year":2020},"citing_paper":{"arxiv_id":"2501.04844","last_updated":"2025-01-08T21:11:35Z","snapshot_observed_at":"2026-08-12T05:25:49.200696Z","submitted_at":"2025-01-08T21:11:35Z","title":"Enhancing Listened Speech Decoding from EEG via Parallel Phoneme Sequence Prediction","version":1},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-10T21:27:46.589419Z"},"links":{"citing_paper":"/paper/2501.04844"},"observation_digest":"sha256:a0a0f80dcdd617d51b1a0b158254560129844bf400a2cb5e7d87645d3fb60206","observation_id":"81a360b6-0556-420a-9e26-9f9f6a33c5f9","resolution":{"observed_at":"2026-08-10T21:27:46.783896Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T21:27:46.593047Z","title":"Connectionist temporal classification: labelling unsegmented sequence data with recurrent neural networks,","venue":null,"work_id":null,"year":2006},"citing_paper":{"arxiv_id":"2501.04844","last_updated":"2025-01-08T21:11:35Z","snapshot_observed_at":"2026-08-12T05:25:49.200696Z","submitted_at":"2025-01-08T21:11:35Z","title":"Enhancing Listened Speech Decoding from EEG via Parallel Phoneme Sequence Prediction","version":1},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-10T21:27:46.593047Z"},"links":{"citing_paper":"/paper/2501.04844"},"observation_digest":"sha256:df27058622251c9655e647d069cfb26cbcd7d3abcd2b577e6070ae78dbdb2335","observation_id":"c6ca949f-c479-49a3-b21a-e6a0e56ee9fc","resolution":{"observed_at":"2026-08-10T21:27:46.593047Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T21:27:46.768097Z","title":"Evoking the n400 event-related potential (erp) component using a publicly available novel set of sentences with semantically incongruent or congruent eggplants (endings),","venue":null,"work_id":"75faee6d-af96-49c6-a6ad-0a471134a162","year":2022},"citing_paper":{"arxiv_id":"2501.04844","last_updated":"2025-01-08T21:11:35Z","snapshot_observed_at":"2026-08-12T05:25:49.200696Z","submitted_at":"2025-01-08T21:11:35Z","title":"Enhancing Listened Speech Decoding from EEG via Parallel Phoneme Sequence Prediction","version":1},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-10T21:27:46.596655Z"},"links":{"citing_paper":"/paper/2501.04844"},"observation_digest":"sha256:331c192b4fa77892cb64f172a484c84c11821a1f7fc27b06f66186e916b742ca","observation_id":"e57b0c88-bd81-4855-aefc-1fc3d68bb0bb","resolution":{"observed_at":"2026-08-10T21:27:46.772195Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T21:27:46.600075Z","title":"Decoupled weight decay regularization,","venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2501.04844","last_updated":"2025-01-08T21:11:35Z","snapshot_observed_at":"2026-08-12T05:25:49.200696Z","submitted_at":"2025-01-08T21:11:35Z","title":"Enhancing Listened Speech Decoding from EEG via Parallel Phoneme Sequence Prediction","version":1},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-08-10T21:27:46.600075Z"},"links":{"citing_paper":"/paper/2501.04844"},"observation_digest":"sha256:3894efa531e43eb9cd2936fd2a5655cd67abd4d9c5a9d4dee5ebba95f0e0ff43","observation_id":"13215e53-62c2-43c9-98cb-390e2da0a76a","resolution":{"observed_at":"2026-08-10T21:27:46.600075Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T21:27:46.748218Z","title":"Mel-cepstral distance measure for objective speech qual- ity assessment,","venue":null,"work_id":"ff255c7c-7b74-4497-a842-93dfa3d0d829","year":1993},"citing_paper":{"arxiv_id":"2501.04844","last_updated":"2025-01-08T21:11:35Z","snapshot_observed_at":"2026-08-12T05:25:49.200696Z","submitted_at":"2025-01-08T21:11:35Z","title":"Enhancing Listened Speech Decoding from EEG via Parallel Phoneme Sequence Prediction","version":1},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-08-10T21:27:46.604671Z"},"links":{"citing_paper":"/paper/2501.04844"},"observation_digest":"sha256:1a3cd403edcacb23e3b8c0a7e39187021f6c8713e16df1beefbcf0735f3d8f79","observation_id":"f5287b50-3f2f-4216-8bbe-6202d52f9c88","resolution":{"observed_at":"2026-08-10T21:27:46.754350Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T21:27:46.608174Z","title":"Montreal Forced Aligner: Trainable Text-Speech Alignment Using Kaldi,","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2501.04844","last_updated":"2025-01-08T21:11:35Z","snapshot_observed_at":"2026-08-12T05:25:49.200696Z","submitted_at":"2025-01-08T21:11:35Z","title":"Enhancing Listened Speech Decoding from EEG via Parallel Phoneme Sequence Prediction","version":1},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-08-10T21:27:46.608174Z"},"links":{"citing_paper":"/paper/2501.04844"},"observation_digest":"sha256:7a6c0a01490a354025984f2dae8aa854cde758827671cccb07fdd4fdbe432dfd","observation_id":"c0ae6f01-bbfd-40c1-9d42-1bd2fb45cef2","resolution":{"observed_at":"2026-08-10T21:27:46.608174Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T21:27:46.585841Z","title":"Available: https://openreview.net/forum?id=HkpbnH9lx","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2501.04844","last_updated":"2025-01-08T21:11:35Z","snapshot_observed_at":"2026-08-12T05:25:49.200696Z","submitted_at":"2025-01-08T21:11:35Z","title":"Enhancing Listened Speech Decoding from EEG via Parallel Phoneme Sequence Prediction","version":1},"reference_index":2017,"source":"pdf_text","source_observed_at":"2026-08-10T21:27:46.585841Z"},"links":{"citing_paper":"/paper/2501.04844"},"observation_digest":"sha256:6b0163d171c68f2377b6004d2cfb7b260c52cc3d8cad70396685ccf7b6517b18","observation_id":"e2b81211-faab-4ae4-8c8b-883f94fbe0e7","resolution":{"observed_at":"2026-08-10T21:27:46.585841Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"paper":{"arxiv_id":"2501.04844","last_updated":"2025-01-08T21:11:35Z","latest_version":1,"primary_category":"eess.AS","snapshot_observed_at":"2026-08-12T05:25:49.200696Z","submitted_at":"2025-01-08T21:11:35Z","title":"Enhancing Listened Speech Decoding from EEG via Parallel Phoneme Sequence Prediction"},"reference_resolution":{"displayed":28,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":10,"verified_exact":0,"verified_fuzzy":18},"total_outbound_references":28},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"thesis":"As of 14 August 2026, this Paper Citation Record lists 28 of 28 outbound references and 0 inbound Pith citation observations for arXiv:2501.04844."}