{"as_of":"2026-08-16T00:35:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:73e286a5f43e67101b55448b7c10a8a4dba85c6a4ddd9ac67bcc4a2fb1a49691","coverage":[{"denominator":23,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":23,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-05T05:21:20.857915Z","state":"measured"},{"denominator":23,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":23,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-15T06:32:42.880941+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2509.05634/citation-record","integrity":"/paper/2509.05634/integrity","json":"/paper/2509.05634/citation-record.json","paper":"/paper/2509.05634"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T05:21:21.401352Z","title":"Cross-modal fusion techniques for utterance-level emotion recognition from text and speech,","venue":null,"work_id":"2600d2bc-7c1e-4904-b589-2e1d98792f78","year":2023},"citing_paper":{"arxiv_id":"2509.05634","last_updated":"2025-09-06T07:40:27Z","snapshot_observed_at":"2026-08-14T07:00:00.734586Z","submitted_at":"2025-09-06T07:40:27Z","title":"On the Contribution of Lexical Features to Speech Emotion Recognition","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-05T05:21:20.772516Z"},"links":{"citing_paper":"/paper/2509.05634"},"observation_digest":"sha256:e1c91a1f6c5818ac1270ecc7c429e14c13e8a892f11247c3dd365a0341b21500","observation_id":"9e9f2fb4-1124-4f3f-a790-6c2aa39b9fc3","resolution":{"observed_at":"2026-08-05T05:21:21.406887Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":"10.2139/ssrn.5057432","metadata_source":"openalex","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T05:30:23.456663Z","title":"Artificial intelligence-driven customer service: Enhancing personalization, loyalty, and customer satisfaction,","venue":"SSRN Electronic Journal","work_id":"65502766-456f-44b0-82a1-16904ac65cfa","year":2024},"citing_paper":{"arxiv_id":"2509.05634","last_updated":"2025-09-06T07:40:27Z","snapshot_observed_at":"2026-08-14T07:00:00.734586Z","submitted_at":"2025-09-06T07:40:27Z","title":"On the Contribution of Lexical Features to Speech Emotion Recognition","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-05T05:21:20.777125Z"},"links":{"citing_paper":"/paper/2509.05634"},"observation_digest":"sha256:7e3bfd51897bb8ac8062025676998ee9f414b664aa440727f1056eecb2509086","observation_id":"5312aca1-1f25-4a6a-9ff4-51d8b485b1d9","resolution":{"observed_at":"2026-08-05T05:21:20.919232Z","resolver_source":"doi","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":"10.1038/s41598-024-52989-2","metadata_source":"openalex","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T05:30:23.456663Z","title":"Speech emotion recognition via graph-based representations,","venue":"Scientific Reports","work_id":"f2402078-3660-4f1e-81a8-017cf7b2d82e","year":2024},"citing_paper":{"arxiv_id":"2509.05634","last_updated":"2025-09-06T07:40:27Z","snapshot_observed_at":"2026-08-14T07:00:00.734586Z","submitted_at":"2025-09-06T07:40:27Z","title":"On the Contribution of Lexical Features to Speech Emotion Recognition","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-05T05:21:20.780996Z"},"links":{"citing_paper":"/paper/2509.05634"},"observation_digest":"sha256:02cb6842523b0be5a89be9eaff0eca7ac8a7636a18a18bf5e64109daec08e275","observation_id":"10a7d42a-ac3d-49df-bdd1-8b86a7863ac8","resolution":{"observed_at":"2026-08-05T05:21:20.905997Z","resolver_source":"doi","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T05:21:21.152303Z","title":"A review on speech emotion recog- nition: A survey, recent advances, challenges, and the influence of noise,","venue":null,"work_id":"c0534b07-40af-4d95-9f86-d195191a0106","year":2024},"citing_paper":{"arxiv_id":"2509.05634","last_updated":"2025-09-06T07:40:27Z","snapshot_observed_at":"2026-08-14T07:00:00.734586Z","submitted_at":"2025-09-06T07:40:27Z","title":"On the Contribution of Lexical Features to Speech Emotion Recognition","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-05T05:21:20.784850Z"},"links":{"citing_paper":"/paper/2509.05634"},"observation_digest":"sha256:a7beec0ea6ff86e87c79374d8cb51796c4a61c9de772fe37bdb16df17e320b59","observation_id":"55ae0269-cbdc-418a-bcf5-0133c044c2d3","resolution":{"observed_at":"2026-08-05T05:21:21.157531Z","resolver_source":"arxiv_id_nonexistent","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":"10.1016/j.specom.2022.03.002","metadata_source":"openalex","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T06:46:29.746714Z","title":"Survey on bimodal speech emotion recognition from acoustic and linguistic informa- tion fusion,","venue":"Speech Communication","work_id":"c7359b0f-e72b-4b25-b005-b93b8b6f0166","year":2022},"citing_paper":{"arxiv_id":"2509.05634","last_updated":"2025-09-06T07:40:27Z","snapshot_observed_at":"2026-08-14T07:00:00.734586Z","submitted_at":"2025-09-06T07:40:27Z","title":"On the Contribution of Lexical Features to Speech Emotion Recognition","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-05T05:21:20.788773Z"},"links":{"citing_paper":"/paper/2509.05634"},"observation_digest":"sha256:c18c4fc987a4a66517e846e54d659a2e97efdb55ec70b9ceffb1fc84973396c9","observation_id":"d3b73810-449a-415d-9dce-dbf4252b556c","resolution":{"observed_at":"2026-08-05T05:21:20.892336Z","resolver_source":"doi","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T05:21:21.386768Z","title":"DST: Deformable Speech Transformer for emotion recognition,","venue":null,"work_id":"d80c872c-3cc2-4f20-969d-e0a41ac73936","year":2023},"citing_paper":{"arxiv_id":"2509.05634","last_updated":"2025-09-06T07:40:27Z","snapshot_observed_at":"2026-08-14T07:00:00.734586Z","submitted_at":"2025-09-06T07:40:27Z","title":"On the Contribution of Lexical Features to Speech Emotion Recognition","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-05T05:21:20.792708Z"},"links":{"citing_paper":"/paper/2509.05634"},"observation_digest":"sha256:e8ec3ea9db65f0b648675f0925360a7ce5f2b394517e0280e7392cdb1a3ecd10","observation_id":"c5152077-6bbf-4b29-b0ca-a7582067c639","resolution":{"observed_at":"2026-08-05T05:21:21.391930Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T05:21:21.372600Z","title":"Temporal-frequency state space duality: An efficient paradigm for speech emotion recognition,","venue":null,"work_id":"740f2ba7-a1bc-47d8-8ab8-55405829fc4a","year":2025},"citing_paper":{"arxiv_id":"2509.05634","last_updated":"2025-09-06T07:40:27Z","snapshot_observed_at":"2026-08-14T07:00:00.734586Z","submitted_at":"2025-09-06T07:40:27Z","title":"On the Contribution of Lexical Features to Speech Emotion Recognition","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-05T05:21:20.797095Z"},"links":{"citing_paper":"/paper/2509.05634"},"observation_digest":"sha256:80f469fb45215a0366e33913ad17d6457c0d9704a35282d043e7446516af63cd","observation_id":"cda0d4a2-ee52-460e-b8a4-81d561b3ea54","resolution":{"observed_at":"2026-08-05T05:21:21.377255Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T05:21:21.358712Z","title":"DWFormer: Dy- namic Window transFormer for speech emotion recognition,","venue":null,"work_id":"9b281ef4-0b42-4c99-824a-de5beaa8cfc1","year":2023},"citing_paper":{"arxiv_id":"2509.05634","last_updated":"2025-09-06T07:40:27Z","snapshot_observed_at":"2026-08-14T07:00:00.734586Z","submitted_at":"2025-09-06T07:40:27Z","title":"On the Contribution of Lexical Features to Speech Emotion Recognition","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-05T05:21:20.800733Z"},"links":{"citing_paper":"/paper/2509.05634"},"observation_digest":"sha256:12c8411ef13836febc50ccafe1796e24fc1bba386cb6eadd18a42ead77b79499","observation_id":"3dd1308e-bf3c-4eea-b73c-0545e584c961","resolution":{"observed_at":"2026-08-05T05:21:21.363600Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T05:21:21.343995Z","title":"SpeechFormer: A hierarchical efficient framework incorporating the characteristics of speech,","venue":null,"work_id":"4fb4a04f-97c8-47f1-908e-bd6b54eea18a","year":2022},"citing_paper":{"arxiv_id":"2509.05634","last_updated":"2025-09-06T07:40:27Z","snapshot_observed_at":"2026-08-14T07:00:00.734586Z","submitted_at":"2025-09-06T07:40:27Z","title":"On the Contribution of Lexical Features to Speech Emotion Recognition","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-05T05:21:20.804368Z"},"links":{"citing_paper":"/paper/2509.05634"},"observation_digest":"sha256:29198f95150ce6d2733a4b8f96178f5192ce352bf44b15def932eea4b473b944","observation_id":"8dbeb2c7-f09b-4185-b33a-e937b52df68a","resolution":{"observed_at":"2026-08-05T05:21:21.349103Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T05:21:21.329164Z","title":"SpeechFormer++: A hierarchical efficient framework for paralinguistic speech processing,","venue":null,"work_id":"cae7421a-291a-41fa-84e4-780623c6a866","year":2023},"citing_paper":{"arxiv_id":"2509.05634","last_updated":"2025-09-06T07:40:27Z","snapshot_observed_at":"2026-08-14T07:00:00.734586Z","submitted_at":"2025-09-06T07:40:27Z","title":"On the Contribution of Lexical Features to Speech Emotion Recognition","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-05T05:21:20.807919Z"},"links":{"citing_paper":"/paper/2509.05634"},"observation_digest":"sha256:122e82f96abb0ac7fa8323a9d23d2d91ddcc574a41cf1fb92af8c6cc0742d209","observation_id":"a6e2dc6d-a7b5-4786-a648-d2ab9502eedc","resolution":{"observed_at":"2026-08-05T05:21:21.334578Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T05:21:21.314580Z","title":"MELD: A multimodal multi-party dataset for emotion recognition in conversations,","venue":null,"work_id":"0c2d5002-117d-4b9b-aac3-15cc326048a1","year":2019},"citing_paper":{"arxiv_id":"2509.05634","last_updated":"2025-09-06T07:40:27Z","snapshot_observed_at":"2026-08-14T07:00:00.734586Z","submitted_at":"2025-09-06T07:40:27Z","title":"On the Contribution of Lexical Features to Speech Emotion Recognition","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-05T05:21:20.811558Z"},"links":{"citing_paper":"/paper/2509.05634"},"observation_digest":"sha256:a767cb638ea6420abc0ffae9412e44f2084b6b0a9c2a874291d5e37a6bf2ea1f","observation_id":"396b83cc-f1fa-4f47-9795-4e11910a6cdf","resolution":{"observed_at":"2026-08-05T05:21:21.319840Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T05:21:21.299021Z","title":"wav2vec 2.0: A framework for self-supervised learning of speech representations,","venue":null,"work_id":"d053d4b7-ced6-487f-aa3a-c3f8679a8000","year":2020},"citing_paper":{"arxiv_id":"2509.05634","last_updated":"2025-09-06T07:40:27Z","snapshot_observed_at":"2026-08-14T07:00:00.734586Z","submitted_at":"2025-09-06T07:40:27Z","title":"On the Contribution of Lexical Features to Speech Emotion Recognition","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-05T05:21:20.815193Z"},"links":{"citing_paper":"/paper/2509.05634"},"observation_digest":"sha256:7ae3f67a0d535af4f8637eda997576e1bf982e7b4c5d1f3d2047b27c5666ee1e","observation_id":"c16c8819-af65-44a1-b2d4-7813a22e1fcf","resolution":{"observed_at":"2026-08-05T05:21:21.304242Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2312.05187","last_updated":"2023-12-08T17:18:42Z","snapshot_observed_at":"2026-08-14T06:59:09.454627Z","submitted_at":"2023-12-08T17:18:42Z","title":"Seamless: Multilingual Expressive and Streaming Speech Translation","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2312.05187","snapshot_observed_at":"2026-08-05T05:21:20.819131Z","title":"Seamless: Multilingual expressive and streaming speech translation,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2509.05634","last_updated":"2025-09-06T07:40:27Z","snapshot_observed_at":"2026-08-14T07:00:00.734586Z","submitted_at":"2025-09-06T07:40:27Z","title":"On the Contribution of Lexical Features to Speech Emotion Recognition","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-05T05:21:20.819131Z"},"links":{"cited_paper":"/paper/2312.05187","citing_paper":"/paper/2509.05634"},"observation_digest":"sha256:45f1fabedd8b77b9fba2038b0308a3ba5d82b43dcf73eefbf75759cec0266a61","observation_id":"3e685189-5188-4e6d-b25d-2e0eaeddabad","resolution":{"observed_at":"2026-08-05T05:21:20.819131Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T05:21:21.284733Z","title":"BERT: Pre-training of deep bidirectional transformers for language understanding,","venue":null,"work_id":"d53c6b9b-5f32-4acb-9797-9fe3b54de618","year":2019},"citing_paper":{"arxiv_id":"2509.05634","last_updated":"2025-09-06T07:40:27Z","snapshot_observed_at":"2026-08-14T07:00:00.734586Z","submitted_at":"2025-09-06T07:40:27Z","title":"On the Contribution of Lexical Features to Speech Emotion Recognition","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-05T05:21:20.823198Z"},"links":{"citing_paper":"/paper/2509.05634"},"observation_digest":"sha256:15e406ef12e90c912b2eab3657ed8b5df85ca8fcd3eba45ed8b399992f458742","observation_id":"1c83cf53-d04a-4454-955a-f5f369df30e8","resolution":{"observed_at":"2026-08-05T05:21:21.289406Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T05:21:21.271154Z","title":"Unsupervised cross-lingual representation learning at scale,","venue":null,"work_id":"ddb4c5ac-6824-4b0c-a144-4ac8a0b1e4fa","year":2020},"citing_paper":{"arxiv_id":"2509.05634","last_updated":"2025-09-06T07:40:27Z","snapshot_observed_at":"2026-08-14T07:00:00.734586Z","submitted_at":"2025-09-06T07:40:27Z","title":"On the Contribution of Lexical Features to Speech Emotion Recognition","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-05T05:21:20.826975Z"},"links":{"citing_paper":"/paper/2509.05634"},"observation_digest":"sha256:a2aa1a889dd73b0c50ee94317e4ce3d381d7b40cad6e5432eef1b9bf5d3562f2","observation_id":"3b694448-ff63-455e-a8a3-c2e8ef6a828e","resolution":{"observed_at":"2026-08-05T05:21:21.275369Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T05:21:21.256317Z","title":"DeBERTa: Decoding-enhanced BERT with disentangled attention,","venue":null,"work_id":"8687d484-3b8b-4cfd-857c-96c5db14563d","year":2021},"citing_paper":{"arxiv_id":"2509.05634","last_updated":"2025-09-06T07:40:27Z","snapshot_observed_at":"2026-08-14T07:00:00.734586Z","submitted_at":"2025-09-06T07:40:27Z","title":"On the Contribution of Lexical Features to Speech Emotion Recognition","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-05T05:21:20.830940Z"},"links":{"citing_paper":"/paper/2509.05634"},"observation_digest":"sha256:f9efe53940c3cac7f616222a8d7e30b2b525364bfae28da7c5bfb362f92c031b","observation_id":"c2f3d554-4f71-45ac-af73-7919569723d1","resolution":{"observed_at":"2026-08-05T05:21:21.261487Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2212.04356","last_updated":"2022-12-06T18:46:04Z","snapshot_observed_at":"2026-08-15T12:11:16.120794Z","submitted_at":"2022-12-06T18:46:04Z","title":"Robust Speech Recognition via Large-Scale Weak Supervision","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2212.04356","snapshot_observed_at":"2026-08-05T05:21:20.834622Z","title":"Robust speech recognition via large-scale weak supervision,","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2509.05634","last_updated":"2025-09-06T07:40:27Z","snapshot_observed_at":"2026-08-14T07:00:00.734586Z","submitted_at":"2025-09-06T07:40:27Z","title":"On the Contribution of Lexical Features to Speech Emotion Recognition","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-05T05:21:20.834622Z"},"links":{"cited_paper":"/paper/2212.04356","citing_paper":"/paper/2509.05634"},"observation_digest":"sha256:c67082d4d03fa14800de6edeb51e1847b7d39c17f7f9d6aeb75262a0e6659bfc","observation_id":"f27e0545-d736-4be4-9ca0-ffc5b9619758","resolution":{"observed_at":"2026-08-05T05:21:20.834622Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T05:21:21.242640Z","title":"Real time speech enhancement in the waveform domain,","venue":null,"work_id":"ccc447b6-1fb4-48e2-8805-daa7082d1eae","year":2020},"citing_paper":{"arxiv_id":"2509.05634","last_updated":"2025-09-06T07:40:27Z","snapshot_observed_at":"2026-08-14T07:00:00.734586Z","submitted_at":"2025-09-06T07:40:27Z","title":"On the Contribution of Lexical Features to Speech Emotion Recognition","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-05T05:21:20.838861Z"},"links":{"citing_paper":"/paper/2509.05634"},"observation_digest":"sha256:f4f696f4a485f55f5f37f1ea19f8ad53c766351786887d235278605ab72e638b","observation_id":"684f59f6-9c84-4b8b-8abd-8b44992ec725","resolution":{"observed_at":"2026-08-05T05:21:21.247137Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T05:21:21.226368Z","title":"Unmasking real-world audio deepfakes: A data-centric approach,","venue":null,"work_id":"d1c8851a-ba5d-42cf-bf64-c709aa33b52d","year":2025},"citing_paper":{"arxiv_id":"2509.05634","last_updated":"2025-09-06T07:40:27Z","snapshot_observed_at":"2026-08-14T07:00:00.734586Z","submitted_at":"2025-09-06T07:40:27Z","title":"On the Contribution of Lexical Features to Speech Emotion Recognition","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-05T05:21:20.842804Z"},"links":{"citing_paper":"/paper/2509.05634"},"observation_digest":"sha256:4965780dac1dfbf4b5a825c9e8bc55365e5b6aaf3e8f39be205c739d8dced502","observation_id":"36d8dd70-8488-4057-a50f-b5a69d5d787f","resolution":{"observed_at":"2026-08-05T05:21:21.232044Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T05:21:21.211294Z","title":"A change of heart: Improving speech emotion recognition through speech-to-text modality conversion","venue":null,"work_id":"d2c5ed56-1af5-4a2b-af10-cad0784aea2e","year":null},"citing_paper":{"arxiv_id":"2509.05634","last_updated":"2025-09-06T07:40:27Z","snapshot_observed_at":"2026-08-14T07:00:00.734586Z","submitted_at":"2025-09-06T07:40:27Z","title":"On the Contribution of Lexical Features to Speech Emotion Recognition","version":1},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-05T05:21:20.846348Z"},"links":{"citing_paper":"/paper/2509.05634"},"observation_digest":"sha256:5aec98d14e4c42f74fd49d37c0b874612b7cdea65ebd821bd89cae63f91cc6d4","observation_id":"6ae965c8-58a2-4cf3-bd36-9f0429836a97","resolution":{"observed_at":"2026-08-05T05:21:21.216507Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T05:21:21.196299Z","title":"TADA: Training-free attribution and out-of-domain detection of audio deepfakes,","venue":null,"work_id":"61786d2a-c7d1-41ce-8eec-6d8b4e4d16d8","year":2025},"citing_paper":{"arxiv_id":"2509.05634","last_updated":"2025-09-06T07:40:27Z","snapshot_observed_at":"2026-08-14T07:00:00.734586Z","submitted_at":"2025-09-06T07:40:27Z","title":"On the Contribution of Lexical Features to Speech Emotion Recognition","version":1},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-05T05:21:20.850412Z"},"links":{"citing_paper":"/paper/2509.05634"},"observation_digest":"sha256:d1411588513f3c8fa1c49d2fe981541b4ad6ba2f18775c7f5a3f8af5b1531206","observation_id":"a9c085dd-ca06-4927-af7f-cdbd826c6f63","resolution":{"observed_at":"2026-08-05T05:21:21.201345Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T05:21:21.181674Z","title":null,"venue":null,"work_id":"24f228aa-80d0-4bf8-955c-d056c9b0bfc0","year":2018},"citing_paper":{"arxiv_id":"2509.05634","last_updated":"2025-09-06T07:40:27Z","snapshot_observed_at":"2026-08-14T07:00:00.734586Z","submitted_at":"2025-09-06T07:40:27Z","title":"On the Contribution of Lexical Features to Speech Emotion Recognition","version":1},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-05T05:21:20.854202Z"},"links":{"citing_paper":"/paper/2509.05634"},"observation_digest":"sha256:4864af2366a4fd213077a082f8a742b1588801227bcce07a3c07d36cb69f98b1","observation_id":"41ace998-d871-445d-8c35-d315301a7fb6","resolution":{"observed_at":"2026-08-05T05:21:21.186045Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T05:21:21.167567Z","title":"An analysis of large speech models-based representations for speech emotion recogni- tion,","venue":null,"work_id":"9824f99c-b88c-4fd6-a397-b55abb190f42","year":2023},"citing_paper":{"arxiv_id":"2509.05634","last_updated":"2025-09-06T07:40:27Z","snapshot_observed_at":"2026-08-14T07:00:00.734586Z","submitted_at":"2025-09-06T07:40:27Z","title":"On the Contribution of Lexical Features to Speech Emotion Recognition","version":1},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-05T05:21:20.857915Z"},"links":{"citing_paper":"/paper/2509.05634"},"observation_digest":"sha256:7876a70b6ca69bef7d67900af1fae01966e5f762776f3d5bc062aef529acacab","observation_id":"d5e418ad-2fee-4996-a9ae-7247b6215a90","resolution":{"observed_at":"2026-08-05T05:21:21.172190Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}}],"paper":{"arxiv_id":"2509.05634","last_updated":"2025-09-06T07:40:27Z","latest_version":1,"primary_category":"eess.AS","snapshot_observed_at":"2026-08-14T07:00:00.734586Z","submitted_at":"2025-09-06T07:40:27Z","title":"On the Contribution of Lexical Features to Speech Emotion Recognition"},"reference_resolution":{"displayed":23,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":3,"verified_exact":4,"verified_fuzzy":16},"total_outbound_references":23},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"thesis":"As of 16 August 2026, this Paper Citation Record lists 23 of 23 outbound references and 0 inbound Pith citation observations for arXiv:2509.05634."}