{"as_of":"2026-08-10T05:35:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:d13bede183d901043ac7392ad0d42b6cd356f22e73af553656c8dfa9c201e8bc","coverage":[{"denominator":36,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":36,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-07T14:34:40.081413Z","state":"measured"},{"denominator":38,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":38,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-09T06:31:02.800959+00:00","state":"measured"},{"denominator":2,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":2,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-07T14:34:39.943231Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"pith","source_observed_at":"2026-08-06T19:08:59.274757Z","state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2505.18484","last_updated":"2025-05-24T03:16:21Z","snapshot_observed_at":"2026-08-07T14:28:31.931608Z","submitted_at":"2025-05-24T03:16:21Z","title":"Token-Level Logits Matter: A Closer Look at Speech Foundation Models for Ambiguous Emotion Recognition","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2505.18484","snapshot_observed_at":"2026-08-07T14:34:39.943231Z","title":"delivery skills","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2505.18484","last_updated":"2025-05-24T03:16:21Z","snapshot_observed_at":"2026-08-07T14:28:31.931608Z","submitted_at":"2025-05-24T03:16:21Z","title":"Token-Level Logits Matter: A Closer Look at Speech Foundation Models for Ambiguous Emotion Recognition","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-07T14:34:39.943231Z"},"links":{"cited_paper":"/paper/2505.18484","citing_paper":"/paper/2505.18484"},"observation_digest":"sha256:3b189f1300a88885cd912f41c85d00b8751613fb7ac7d8fec39c0120fd28b8d9","observation_id":"2f4dce82-3a37-479b-a928-ee231547cc4d","resolution":{"observed_at":"2026-08-07T14:34:39.943231Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2505.18484","last_updated":"2025-05-24T03:16:21Z","snapshot_observed_at":"2026-08-07T14:28:31.931608Z","submitted_at":"2025-05-24T03:16:21Z","title":"Token-Level Logits Matter: A Closer Look at Speech Foundation Models for Ambiguous Emotion Recognition","version":1},"cited_work":{"arxiv_id":"2505.18484","doi":null,"metadata_source":"pith","pith_arxiv_id":"2505.18484","snapshot_observed_at":"2026-08-06T19:08:59.274757Z","title":"Token-Level Logits Matter: A Closer Look at Speech Foundation Models for Ambiguous Emotion Recognition","venue":"cs.SD","work_id":"dc33261b-365e-48c9-a817-b65106977d40","year":2025},"citing_paper":{"arxiv_id":"2507.08031","last_updated":"2025-07-14T01:10:56Z","snapshot_observed_at":"2026-08-09T15:18:04.025388Z","submitted_at":"2025-07-09T02:40:02Z","title":"Beyond Scale: Small Language Models are Comparable to GPT-4 in Mental Health Understanding","version":2},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-06T19:08:56.780027Z"},"links":{"cited_paper":"/paper/2505.18484","citing_paper":"/paper/2507.08031"},"observation_digest":"sha256:9749d76b1ec5dcb87a22235d53e941bb47a3f21a3d9394004812f1164d6b321e","observation_id":"d0cf2ed4-002f-405d-88a0-61037b8c5166","resolution":{"observed_at":"2026-08-06T19:08:59.364163Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}}],"links":{"evidence":"/evidence","html":"/paper/2505.18484/citation-record","integrity":"/paper/2505.18484/integrity","json":"/paper/2505.18484/citation-record.json","paper":"/paper/2505.18484"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:34:40.514252Z","title":"articulate","venue":null,"work_id":"e4240867-2399-4086-b23b-82579296ddbf","year":null},"citing_paper":{"arxiv_id":"2505.18484","last_updated":"2025-05-24T03:16:21Z","snapshot_observed_at":"2026-08-07T14:28:31.931608Z","submitted_at":"2025-05-24T03:16:21Z","title":"Token-Level Logits Matter: A Closer Look at Speech Foundation Models for Ambiguous Emotion Recognition","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-07T14:34:39.937922Z"},"links":{"citing_paper":"/paper/2505.18484"},"observation_digest":"sha256:097a1f7c376308372b69e10fab0e9444ecc15ded9f3723b559432bb9ee2e1f3a","observation_id":"ceb724ee-326e-485f-9289-1f38c0881b09","resolution":{"observed_at":"2026-08-07T14:34:40.518009Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2505.18484","last_updated":"2025-05-24T03:16:21Z","snapshot_observed_at":"2026-08-07T14:28:31.931608Z","submitted_at":"2025-05-24T03:16:21Z","title":"Token-Level Logits Matter: A Closer Look at Speech Foundation Models for Ambiguous Emotion Recognition","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2505.18484","snapshot_observed_at":"2026-08-07T14:34:39.943231Z","title":"delivery skills","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2505.18484","last_updated":"2025-05-24T03:16:21Z","snapshot_observed_at":"2026-08-07T14:28:31.931608Z","submitted_at":"2025-05-24T03:16:21Z","title":"Token-Level Logits Matter: A Closer Look at Speech Foundation Models for Ambiguous Emotion Recognition","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-07T14:34:39.943231Z"},"links":{"cited_paper":"/paper/2505.18484","citing_paper":"/paper/2505.18484"},"observation_digest":"sha256:3b189f1300a88885cd912f41c85d00b8751613fb7ac7d8fec39c0120fd28b8d9","observation_id":"2f4dce82-3a37-479b-a928-ee231547cc4d","resolution":{"observed_at":"2026-08-07T14:34:39.943231Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:34:40.502477Z","title":"ang”, followed by “er","venue":null,"work_id":"67512403-0832-4ad9-a7d2-f09f817a18d0","year":null},"citing_paper":{"arxiv_id":"2505.18484","last_updated":"2025-05-24T03:16:21Z","snapshot_observed_at":"2026-08-07T14:28:31.931608Z","submitted_at":"2025-05-24T03:16:21Z","title":"Token-Level Logits Matter: A Closer Look at Speech Foundation Models for Ambiguous Emotion Recognition","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-07T14:34:39.947336Z"},"links":{"citing_paper":"/paper/2505.18484"},"observation_digest":"sha256:afbf99a161d7ae2622a2b04003ef0220422ad377d893eb881d75fe0ea9f2f7bd","observation_id":"f9ad77d0-9c4e-4490-a303-d8ca2a222d84","resolution":{"observed_at":"2026-08-07T14:34:40.506799Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:34:40.489823Z","title":null,"venue":null,"work_id":"7e3d4b5b-817d-48a8-8a71-b3b49cd00458","year":null},"citing_paper":{"arxiv_id":"2505.18484","last_updated":"2025-05-24T03:16:21Z","snapshot_observed_at":"2026-08-07T14:28:31.931608Z","submitted_at":"2025-05-24T03:16:21Z","title":"Token-Level Logits Matter: A Closer Look at Speech Foundation Models for Ambiguous Emotion Recognition","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-07T14:34:39.952181Z"},"links":{"citing_paper":"/paper/2505.18484"},"observation_digest":"sha256:85de6bb6979dcac84d19dbf447ccc94a9ec3e77a600211ca551dd3f4aa7bc496","observation_id":"9727d8f2-1ac1-45b9-aac6-ef92648a0854","resolution":{"observed_at":"2026-08-07T14:34:40.493956Z","resolver_source":"raw_fallback","status":"parse_uncertain"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:34:40.478669Z","title":"iness 6.46 2.44 0.43 0.08 0.7","venue":null,"work_id":"55bc930c-68e0-4906-a7c2-3f07c5b1c5bd","year":null},"citing_paper":{"arxiv_id":"2505.18484","last_updated":"2025-05-24T03:16:21Z","snapshot_observed_at":"2026-08-07T14:28:31.931608Z","submitted_at":"2025-05-24T03:16:21Z","title":"Token-Level Logits Matter: A Closer Look at Speech Foundation Models for Ambiguous Emotion Recognition","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-07T14:34:39.956621Z"},"links":{"citing_paper":"/paper/2505.18484"},"observation_digest":"sha256:42d5612328c77a3e0eb73b72e3fb82512dadc4b4dd2aea2b30c21eba3fe835ae","observation_id":"162b2ddc-0356-4d85-9d8b-be6b00a467fe","resolution":{"observed_at":"2026-08-07T14:34:40.482747Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:34:40.467094Z","title":null,"venue":null,"work_id":"1323fabf-13b4-4f99-9b34-a72eb25c1080","year":null},"citing_paper":{"arxiv_id":"2505.18484","last_updated":"2025-05-24T03:16:21Z","snapshot_observed_at":"2026-08-07T14:28:31.931608Z","submitted_at":"2025-05-24T03:16:21Z","title":"Token-Level Logits Matter: A Closer Look at Speech Foundation Models for Ambiguous Emotion Recognition","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-07T14:34:39.960467Z"},"links":{"citing_paper":"/paper/2505.18484"},"observation_digest":"sha256:c5d77f0044ce3b2564dda86c3847b7b8a63858a387e7b329c02f4062658e4c2d","observation_id":"d58368ca-9bf7-48c6-831e-4752d2b39148","resolution":{"observed_at":"2026-08-07T14:34:40.470922Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:34:40.453336Z","title":"Performance on ambiguous SER Table 1 presents the performance of ambiguous SER using ambiguity-based metrics, evaluating the entire distribution pre- dictions","venue":null,"work_id":"d685970d-a10f-4c49-a640-83d738d86788","year":null},"citing_paper":{"arxiv_id":"2505.18484","last_updated":"2025-05-24T03:16:21Z","snapshot_observed_at":"2026-08-07T14:28:31.931608Z","submitted_at":"2025-05-24T03:16:21Z","title":"Token-Level Logits Matter: A Closer Look at Speech Foundation Models for Ambiguous Emotion Recognition","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-07T14:34:39.964972Z"},"links":{"citing_paper":"/paper/2505.18484"},"observation_digest":"sha256:66907f42616b82d091ad08691e738a5d360089977891f48d2e7aafc72b70fa8f","observation_id":"e60dbd52-17ea-4ab7-bfb4-7a0dc9e926f7","resolution":{"observed_at":"2026-08-07T14:34:40.458230Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:34:40.441127Z","title":null,"venue":null,"work_id":"79b71f85-f81a-4893-b0a4-fa54721f437b","year":null},"citing_paper":{"arxiv_id":"2505.18484","last_updated":"2025-05-24T03:16:21Z","snapshot_observed_at":"2026-08-07T14:28:31.931608Z","submitted_at":"2025-05-24T03:16:21Z","title":"Token-Level Logits Matter: A Closer Look at Speech Foundation Models for Ambiguous Emotion Recognition","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-07T14:34:39.969631Z"},"links":{"citing_paper":"/paper/2505.18484"},"observation_digest":"sha256:ccfbe55602bc1fd211d076ae31014286122339ff90f2bb2bde0f5835c2e9c85e","observation_id":"b77a4294-41ae-47f3-86d6-85906e4a459e","resolution":{"observed_at":"2026-08-07T14:34:40.445105Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:34:40.428860Z","title":"Speech emotion recognition using su- pervised deep recurrent system for mental health monitoring,","venue":null,"work_id":"0148479f-4d73-4434-91bd-25da1a509c6e","year":2024},"citing_paper":{"arxiv_id":"2505.18484","last_updated":"2025-05-24T03:16:21Z","snapshot_observed_at":"2026-08-07T14:28:31.931608Z","submitted_at":"2025-05-24T03:16:21Z","title":"Token-Level Logits Matter: A Closer Look at Speech Foundation Models for Ambiguous Emotion Recognition","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-07T14:34:39.973471Z"},"links":{"citing_paper":"/paper/2505.18484"},"observation_digest":"sha256:aeb1ca64f697172c3159a2dda0071709fa5317ac2586e4623006d15c10b3d59c","observation_id":"b10068ab-5200-40ff-8bd9-308d87c67a97","resolution":{"observed_at":"2026-08-07T14:34:40.433202Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:34:40.416654Z","title":"Speech emotion recogni- tion approaches in human computer interaction,","venue":null,"work_id":"78114d07-17f0-4fce-8247-e3642286bfdd","year":2013},"citing_paper":{"arxiv_id":"2505.18484","last_updated":"2025-05-24T03:16:21Z","snapshot_observed_at":"2026-08-07T14:28:31.931608Z","submitted_at":"2025-05-24T03:16:21Z","title":"Token-Level Logits Matter: A Closer Look at Speech Foundation Models for Ambiguous Emotion Recognition","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-07T14:34:39.977398Z"},"links":{"citing_paper":"/paper/2505.18484"},"observation_digest":"sha256:addafffedd4d88ddbac5bbcee1f68e50c054320e36021ef37adc4512ebcf08f4","observation_id":"b7ac49fc-b52c-4913-bb7e-d096c11a17c1","resolution":{"observed_at":"2026-08-07T14:34:40.420540Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:34:40.403402Z","title":"Beyond silent letters: Amplifying llms in emotion recognition with vocal nuances,","venue":null,"work_id":"782cc85b-f6bd-48fb-bc94-be653ed4b7ef","year":2024},"citing_paper":{"arxiv_id":"2505.18484","last_updated":"2025-05-24T03:16:21Z","snapshot_observed_at":"2026-08-07T14:28:31.931608Z","submitted_at":"2025-05-24T03:16:21Z","title":"Token-Level Logits Matter: A Closer Look at Speech Foundation Models for Ambiguous Emotion Recognition","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-07T14:34:39.981924Z"},"links":{"citing_paper":"/paper/2505.18484"},"observation_digest":"sha256:5887441a6f103bec74f442ca6854f0b17821ccb3757e1e47e9f7bb7b6ddacf1a","observation_id":"c615b57c-b495-4fec-9242-2070302efb02","resolution":{"observed_at":"2026-08-07T14:34:40.408252Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:34:40.390629Z","title":"From text to emotion: Unveiling the emotion annotation capabilities of llms,","venue":null,"work_id":"eeab6731-0440-4310-89c9-b4d42d8ab33b","year":2024},"citing_paper":{"arxiv_id":"2505.18484","last_updated":"2025-05-24T03:16:21Z","snapshot_observed_at":"2026-08-07T14:28:31.931608Z","submitted_at":"2025-05-24T03:16:21Z","title":"Token-Level Logits Matter: A Closer Look at Speech Foundation Models for Ambiguous Emotion Recognition","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-07T14:34:39.985505Z"},"links":{"citing_paper":"/paper/2505.18484"},"observation_digest":"sha256:b280f77caf5ecbf63dc6ae2ccab1f28d0085bffc31ba7c0a6e31ffd43c7818fe","observation_id":"23a65b8c-d306-4f90-8c3b-d403cd64643e","resolution":{"observed_at":"2026-08-07T14:34:40.394965Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:34:39.989281Z","title":"Foundation model assisted automatic speech emotion recognition: Transcribing, annotating, and aug- menting,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.18484","last_updated":"2025-05-24T03:16:21Z","snapshot_observed_at":"2026-08-07T14:28:31.931608Z","submitted_at":"2025-05-24T03:16:21Z","title":"Token-Level Logits Matter: A Closer Look at Speech Foundation Models for Ambiguous Emotion Recognition","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-07T14:34:39.989281Z"},"links":{"citing_paper":"/paper/2505.18484"},"observation_digest":"sha256:4492a226c4a01b02334aa9f0fac38e2df5c2e88e0d096aa5458435613d248784","observation_id":"c83cbbf4-3fdb-4864-82e0-4d1782aebb1b","resolution":{"observed_at":"2026-08-07T14:34:39.989281Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:34:40.371836Z","title":"Interpreting ambiguous emotional ex- pressions,","venue":null,"work_id":"2b853ae7-1c34-403f-a36c-9ffe6cad9cc9","year":2009},"citing_paper":{"arxiv_id":"2505.18484","last_updated":"2025-05-24T03:16:21Z","snapshot_observed_at":"2026-08-07T14:28:31.931608Z","submitted_at":"2025-05-24T03:16:21Z","title":"Token-Level Logits Matter: A Closer Look at Speech Foundation Models for Ambiguous Emotion Recognition","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-07T14:34:39.993193Z"},"links":{"citing_paper":"/paper/2505.18484"},"observation_digest":"sha256:fee7cc5be8f8a40772ebdfb59cb8ab0addd629515518459badb3dba27c3205c6","observation_id":"1e2be274-14c1-416b-b1c7-68aa6382ad07","resolution":{"observed_at":"2026-08-07T14:34:40.375569Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:34:40.359805Z","title":"Emotion recog- nition systems must embrace ambiguity,","venue":null,"work_id":"d3bfff61-721b-4b4a-9b86-dbde38a45385","year":2024},"citing_paper":{"arxiv_id":"2505.18484","last_updated":"2025-05-24T03:16:21Z","snapshot_observed_at":"2026-08-07T14:28:31.931608Z","submitted_at":"2025-05-24T03:16:21Z","title":"Token-Level Logits Matter: A Closer Look at Speech Foundation Models for Ambiguous Emotion Recognition","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-07T14:34:39.996641Z"},"links":{"citing_paper":"/paper/2505.18484"},"observation_digest":"sha256:252971a5b7c9336fda26a6b13d0f3a8c7ed8c743dc34c0b74f46d2ef6bc3241f","observation_id":"358189d0-c283-40e2-9a88-25e59c59a193","resolution":{"observed_at":"2026-08-07T14:34:40.364400Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:34:40.349309Z","title":"An investi- gation of emotion prediction uncertainty using gaussian mixture regression","venue":null,"work_id":"fcd46292-3813-46f8-89cf-df08052d4228","year":2017},"citing_paper":{"arxiv_id":"2505.18484","last_updated":"2025-05-24T03:16:21Z","snapshot_observed_at":"2026-08-07T14:28:31.931608Z","submitted_at":"2025-05-24T03:16:21Z","title":"Token-Level Logits Matter: A Closer Look at Speech Foundation Models for Ambiguous Emotion Recognition","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-07T14:34:40.004953Z"},"links":{"citing_paper":"/paper/2505.18484"},"observation_digest":"sha256:9e55b6fbaa0f42e8b62c704fb0cd717bddea1ba195f37283da02c5828ec8d86f","observation_id":"ab774182-4eb0-4374-9649-ccb6f38d350e","resolution":{"observed_at":"2026-08-07T14:34:40.353131Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:34:40.338747Z","title":"Dynamic multi-rater gaussian mixture regression incorporating temporal dependencies of emotion uncertainty using kalman filters,","venue":null,"work_id":"4c0e6ccd-b2a5-4220-9446-c9ddbabdd0fa","year":2018},"citing_paper":{"arxiv_id":"2505.18484","last_updated":"2025-05-24T03:16:21Z","snapshot_observed_at":"2026-08-07T14:28:31.931608Z","submitted_at":"2025-05-24T03:16:21Z","title":"Token-Level Logits Matter: A Closer Look at Speech Foundation Models for Ambiguous Emotion Recognition","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-07T14:34:40.009475Z"},"links":{"citing_paper":"/paper/2505.18484"},"observation_digest":"sha256:d9b7df5e537572512c8b35602beea8eded70d9fec903639cdac3ef7129309273","observation_id":"1d2e9abb-0e53-4f32-83d5-a07143b690c8","resolution":{"observed_at":"2026-08-07T14:34:40.342621Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:34:40.327028Z","title":"Child emotion recognition using probabilistic neural network with effective features,","venue":null,"work_id":"727eb8c0-a496-489f-a6e4-a3e23341c443","year":2020},"citing_paper":{"arxiv_id":"2505.18484","last_updated":"2025-05-24T03:16:21Z","snapshot_observed_at":"2026-08-07T14:28:31.931608Z","submitted_at":"2025-05-24T03:16:21Z","title":"Token-Level Logits Matter: A Closer Look at Speech Foundation Models for Ambiguous Emotion Recognition","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-07T14:34:40.013320Z"},"links":{"citing_paper":"/paper/2505.18484"},"observation_digest":"sha256:98fe2784a595be50e530e48be3dd4892a47236e22e466f3c482245539d9c2565","observation_id":"d4b221f7-2ff7-4b78-9e67-da65a10f6471","resolution":{"observed_at":"2026-08-07T14:34:40.331650Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:34:40.315765Z","title":"Text emotion distribution learning via multi-task convolutional neural network","venue":null,"work_id":"614feb82-9515-449e-8a27-d16f2ff6d1ec","year":2018},"citing_paper":{"arxiv_id":"2505.18484","last_updated":"2025-05-24T03:16:21Z","snapshot_observed_at":"2026-08-07T14:28:31.931608Z","submitted_at":"2025-05-24T03:16:21Z","title":"Token-Level Logits Matter: A Closer Look at Speech Foundation Models for Ambiguous Emotion Recognition","version":1},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-07T14:34:40.016783Z"},"links":{"citing_paper":"/paper/2505.18484"},"observation_digest":"sha256:1eb11d54f27bd54799bb7d771958944634eecd7a2887f034b2d0ba51dfa45630","observation_id":"ecd59617-02d2-4387-9e8f-fb12fe70d5ea","resolution":{"observed_at":"2026-08-07T14:34:40.319847Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:34:40.304464Z","title":"A novel se- quential monte carlo framework for predicting ambiguous emo- tion states,","venue":null,"work_id":"6d575f8b-53f2-4a62-9fec-f3c013ca9e1d","year":2022},"citing_paper":{"arxiv_id":"2505.18484","last_updated":"2025-05-24T03:16:21Z","snapshot_observed_at":"2026-08-07T14:28:31.931608Z","submitted_at":"2025-05-24T03:16:21Z","title":"Token-Level Logits Matter: A Closer Look at Speech Foundation Models for Ambiguous Emotion Recognition","version":1},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-07T14:34:40.021081Z"},"links":{"citing_paper":"/paper/2505.18484"},"observation_digest":"sha256:4a11ea9b14c4505d568e8cce23c26aaec74d819a239e45f762dfa6533ca8185e","observation_id":"a9f3acc7-d4ca-488d-b758-049ac6f5d76c","resolution":{"observed_at":"2026-08-07T14:34:40.308531Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:34:40.291824Z","title":"Dual-constrained dynamical neural odes for ambiguity-aware continuous emotion prediction,","venue":null,"work_id":"746f453e-9295-4d13-90d0-e544934df48a","year":2024},"citing_paper":{"arxiv_id":"2505.18484","last_updated":"2025-05-24T03:16:21Z","snapshot_observed_at":"2026-08-07T14:28:31.931608Z","submitted_at":"2025-05-24T03:16:21Z","title":"Token-Level Logits Matter: A Closer Look at Speech Foundation Models for Ambiguous Emotion Recognition","version":1},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-07T14:34:40.024819Z"},"links":{"citing_paper":"/paper/2505.18484"},"observation_digest":"sha256:b69c31036af4df5384f92bf0fca19628c83bb6046855669a4e64f0a2c560d605","observation_id":"d8dc7226-bbcc-42b5-8242-7a675eee69d0","resolution":{"observed_at":"2026-08-07T14:34:40.295557Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:34:40.278523Z","title":"Aer-llm: Ambiguity- aware emotion recognition leveraging large language models,","venue":null,"work_id":"b723428d-639a-49eb-a49b-da3105c88479","year":2024},"citing_paper":{"arxiv_id":"2505.18484","last_updated":"2025-05-24T03:16:21Z","snapshot_observed_at":"2026-08-07T14:28:31.931608Z","submitted_at":"2025-05-24T03:16:21Z","title":"Token-Level Logits Matter: A Closer Look at Speech Foundation Models for Ambiguous Emotion Recognition","version":1},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-07T14:34:40.028315Z"},"links":{"citing_paper":"/paper/2505.18484"},"observation_digest":"sha256:68b57eb993ce5677f45dcf201968ca41a236ea8bd195bc251a01a2dc9ec7b1ac","observation_id":"57e4a674-5483-48d4-b072-1d6c043376be","resolution":{"observed_at":"2026-08-07T14:34:40.283330Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:34:40.266763Z","title":"Robust speech emotion recognition using cnn+ lstm based on stochastic fractal search optimization algorithm,","venue":null,"work_id":"f6d57378-7283-4ec1-84a8-84db1e0bc9d7","year":2022},"citing_paper":{"arxiv_id":"2505.18484","last_updated":"2025-05-24T03:16:21Z","snapshot_observed_at":"2026-08-07T14:28:31.931608Z","submitted_at":"2025-05-24T03:16:21Z","title":"Token-Level Logits Matter: A Closer Look at Speech Foundation Models for Ambiguous Emotion Recognition","version":1},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-07T14:34:40.031852Z"},"links":{"citing_paper":"/paper/2505.18484"},"observation_digest":"sha256:af9eecc0831d3604b5b54fad3d0c1741e2d3c02e1e5566481cf91de3154e3f1b","observation_id":"51e3bc6a-8fd7-4950-af47-16fbda7e5653","resolution":{"observed_at":"2026-08-07T14:34:40.270970Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:34:40.255347Z","title":"Speech emo- tion recognition based on multi-feature speed rate and lstm,","venue":null,"work_id":"8d26d4e6-c8c8-49fd-b011-c1dfd7299dfe","year":2024},"citing_paper":{"arxiv_id":"2505.18484","last_updated":"2025-05-24T03:16:21Z","snapshot_observed_at":"2026-08-07T14:28:31.931608Z","submitted_at":"2025-05-24T03:16:21Z","title":"Token-Level Logits Matter: A Closer Look at Speech Foundation Models for Ambiguous Emotion Recognition","version":1},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-08-07T14:34:40.035605Z"},"links":{"citing_paper":"/paper/2505.18484"},"observation_digest":"sha256:b4937104074e034343f8786df5ce0e380ee2a2218bfb416820e30430baa50991","observation_id":"90465bd4-be80-4e31-be34-38fa8b631607","resolution":{"observed_at":"2026-08-07T14:34:40.259543Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:34:40.242852Z","title":"Multimodal speech emotion recognition based on large language model,","venue":null,"work_id":"64cbc8e6-345b-4662-a0c3-a0b79898e6d7","year":2024},"citing_paper":{"arxiv_id":"2505.18484","last_updated":"2025-05-24T03:16:21Z","snapshot_observed_at":"2026-08-07T14:28:31.931608Z","submitted_at":"2025-05-24T03:16:21Z","title":"Token-Level Logits Matter: A Closer Look at Speech Foundation Models for Ambiguous Emotion Recognition","version":1},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-08-07T14:34:40.039132Z"},"links":{"citing_paper":"/paper/2505.18484"},"observation_digest":"sha256:20b3f0203869090cdb869d523ace0d2e2c63ff0f80251a1d6c3efae12a2e39fd","observation_id":"9a7a54e8-28e0-4640-b64a-7c579543e0dc","resolution":{"observed_at":"2026-08-07T14:34:40.247295Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:34:40.231264Z","title":"Mul- timodal emotion recognition using feature fusion: An llm-based approach,","venue":null,"work_id":"433b80ef-178b-481d-8f50-c1bbdfaec143","year":2024},"citing_paper":{"arxiv_id":"2505.18484","last_updated":"2025-05-24T03:16:21Z","snapshot_observed_at":"2026-08-07T14:28:31.931608Z","submitted_at":"2025-05-24T03:16:21Z","title":"Token-Level Logits Matter: A Closer Look at Speech Foundation Models for Ambiguous Emotion Recognition","version":1},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-08-07T14:34:40.042461Z"},"links":{"citing_paper":"/paper/2505.18484"},"observation_digest":"sha256:d8d4b70e5cf539501a5caf201f95b7bf40af3ab6ad8aca8a7d605dbe42399784","observation_id":"6627bb96-7d3c-43db-b6d4-ca9c7245429d","resolution":{"observed_at":"2026-08-07T14:34:40.235094Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:34:40.220370Z","title":"Interpreting ambiguous emotional expressions,","venue":null,"work_id":"4fa3b874-19cf-4d43-a379-29e183e6d98f","year":2009},"citing_paper":{"arxiv_id":"2505.18484","last_updated":"2025-05-24T03:16:21Z","snapshot_observed_at":"2026-08-07T14:28:31.931608Z","submitted_at":"2025-05-24T03:16:21Z","title":"Token-Level Logits Matter: A Closer Look at Speech Foundation Models for Ambiguous Emotion Recognition","version":1},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-08-07T14:34:40.045880Z"},"links":{"citing_paper":"/paper/2505.18484"},"observation_digest":"sha256:bde3d033ce74feb2100084e771919474e21d1aef3049dcee4c7f0406953ce004","observation_id":"bbc1c962-b208-4e6d-8b2a-cdb0ba1b87e9","resolution":{"observed_at":"2026-08-07T14:34:40.224117Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:34:40.207984Z","title":"Multi-classifier interactive learning for ambiguous speech emotion recognition,","venue":null,"work_id":"36152fc7-ff89-4437-ad03-5a0293e7bd98","year":2022},"citing_paper":{"arxiv_id":"2505.18484","last_updated":"2025-05-24T03:16:21Z","snapshot_observed_at":"2026-08-07T14:28:31.931608Z","submitted_at":"2025-05-24T03:16:21Z","title":"Token-Level Logits Matter: A Closer Look at Speech Foundation Models for Ambiguous Emotion Recognition","version":1},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-08-07T14:34:40.050685Z"},"links":{"citing_paper":"/paper/2505.18484"},"observation_digest":"sha256:9623ccf9b7845e93c9c869c99a6640769a64789c28b3a692d7dea4d6b6e1b236","observation_id":"014415cd-e538-4d50-b584-6a65ec44b510","resolution":{"observed_at":"2026-08-07T14:34:40.212314Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2402.12862","last_updated":"2024-02-20T09:53:38Z","snapshot_observed_at":"2026-07-06T17:32:44.565172Z","submitted_at":"2024-02-20T09:53:38Z","title":"Handling Ambiguity in Emotion: From Out-of-Domain Detection to Distribution Estimation","version":1},"cited_work":{"arxiv_id":"2402.12862","doi":null,"metadata_source":"pith","pith_arxiv_id":"2402.12862","snapshot_observed_at":"2026-08-07T14:34:40.123018Z","title":"Handling Ambiguity in Emotion: From Out-of-Domain Detection to Distribution Estimation","venue":"cs.CL","work_id":"38b7cfe5-9518-4333-9a63-e08df75f70c8","year":2024},"citing_paper":{"arxiv_id":"2505.18484","last_updated":"2025-05-24T03:16:21Z","snapshot_observed_at":"2026-08-07T14:28:31.931608Z","submitted_at":"2025-05-24T03:16:21Z","title":"Token-Level Logits Matter: A Closer Look at Speech Foundation Models for Ambiguous Emotion Recognition","version":1},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-08-07T14:34:40.053991Z"},"links":{"cited_paper":"/paper/2402.12862","citing_paper":"/paper/2505.18484"},"observation_digest":"sha256:a55a0b3691ba4ba54fa784dfbd5ee8434cd394e3007b7eb4525bbaf52a9a08b0","observation_id":"4069a32d-fdf7-4177-b7e4-966abd6cb4e8","resolution":{"observed_at":"2026-08-07T14:34:40.129002Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:34:40.196030Z","title":"Using gaussian processes with lstm neural networks to predict continuous-time, dimen- sional emotion in ambiguous speech,","venue":null,"work_id":"d2065ff8-d661-46da-a87c-de0d487bd387","year":2019},"citing_paper":{"arxiv_id":"2505.18484","last_updated":"2025-05-24T03:16:21Z","snapshot_observed_at":"2026-08-07T14:28:31.931608Z","submitted_at":"2025-05-24T03:16:21Z","title":"Token-Level Logits Matter: A Closer Look at Speech Foundation Models for Ambiguous Emotion Recognition","version":1},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-08-07T14:34:40.058137Z"},"links":{"citing_paper":"/paper/2505.18484"},"observation_digest":"sha256:b45c4c4166cb123909bf0e0c582524ff1aa6efe11dbe3cf70ee21e94d1e28eee","observation_id":"7c2dddc4-6849-42e4-99d4-3708d73e46af","resolution":{"observed_at":"2026-08-07T14:34:40.201003Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:34:40.185376Z","title":"Emotionally numb or empathetic? evaluating how llms feel using emotionbench,","venue":null,"work_id":"c27f8991-f089-4771-bcb8-c2f72a93f26b","year":2023},"citing_paper":{"arxiv_id":"2505.18484","last_updated":"2025-05-24T03:16:21Z","snapshot_observed_at":"2026-08-07T14:28:31.931608Z","submitted_at":"2025-05-24T03:16:21Z","title":"Token-Level Logits Matter: A Closer Look at Speech Foundation Models for Ambiguous Emotion Recognition","version":1},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-08-07T14:34:40.061736Z"},"links":{"citing_paper":"/paper/2505.18484"},"observation_digest":"sha256:a258ee4190909c94f012a983b889d5977b0b39cf1d610e87c20e1337f70a5330","observation_id":"e7442c27-3216-407a-a91b-506acf1247cb","resolution":{"observed_at":"2026-08-07T14:34:40.188829Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:34:40.065616Z","title":"Iemocap: Interactive emotional dyadic motion capture database,","venue":null,"work_id":null,"year":2008},"citing_paper":{"arxiv_id":"2505.18484","last_updated":"2025-05-24T03:16:21Z","snapshot_observed_at":"2026-08-07T14:28:31.931608Z","submitted_at":"2025-05-24T03:16:21Z","title":"Token-Level Logits Matter: A Closer Look at Speech Foundation Models for Ambiguous Emotion Recognition","version":1},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-08-07T14:34:40.065616Z"},"links":{"citing_paper":"/paper/2505.18484"},"observation_digest":"sha256:b9bf42fbcc1e6614ec358b3ebaf45278259574595c738cea7689df5e23c484b0","observation_id":"b4898dd0-bc1f-466c-ab81-acd5b1a638c8","resolution":{"observed_at":"2026-08-07T14:34:40.065616Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:34:40.069502Z","title":"Joint audio and speech understanding,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.18484","last_updated":"2025-05-24T03:16:21Z","snapshot_observed_at":"2026-08-07T14:28:31.931608Z","submitted_at":"2025-05-24T03:16:21Z","title":"Token-Level Logits Matter: A Closer Look at Speech Foundation Models for Ambiguous Emotion Recognition","version":1},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-08-07T14:34:40.069502Z"},"links":{"citing_paper":"/paper/2505.18484"},"observation_digest":"sha256:ca0137ad6fa57ff460d8120c7f6cc0f5a28e3690a2c6b5f977b379100197bef3","observation_id":"9b01b4c5-364c-48d6-b95f-e89a1d3def48","resolution":{"observed_at":"2026-08-07T14:34:40.069502Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:34:40.161200Z","title":"Robust speech recognition via large-scale weak su- pervision,","venue":null,"work_id":"7593957d-3133-4432-96a4-1b63f3c5ae1f","year":2023},"citing_paper":{"arxiv_id":"2505.18484","last_updated":"2025-05-24T03:16:21Z","snapshot_observed_at":"2026-08-07T14:28:31.931608Z","submitted_at":"2025-05-24T03:16:21Z","title":"Token-Level Logits Matter: A Closer Look at Speech Foundation Models for Ambiguous Emotion Recognition","version":1},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-08-07T14:34:40.073296Z"},"links":{"citing_paper":"/paper/2505.18484"},"observation_digest":"sha256:a04b94f4c492e5add1a9e4f01459a9febf9af63a9d80223bebc10476b6e807dd","observation_id":"319f9368-c3da-4c74-a19a-874b69a81e19","resolution":{"observed_at":"2026-08-07T14:34:40.165002Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:34:40.149698Z","title":"Listen, think, and understand,","venue":null,"work_id":"fcd3aad6-0d1d-4101-aa60-57292e019cad","year":2024},"citing_paper":{"arxiv_id":"2505.18484","last_updated":"2025-05-24T03:16:21Z","snapshot_observed_at":"2026-08-07T14:28:31.931608Z","submitted_at":"2025-05-24T03:16:21Z","title":"Token-Level Logits Matter: A Closer Look at Speech Foundation Models for Ambiguous Emotion Recognition","version":1},"reference_index":36,"source":"pdf_text","source_observed_at":"2026-08-07T14:34:40.076975Z"},"links":{"citing_paper":"/paper/2505.18484"},"observation_digest":"sha256:240844b6ab561890ad2c0e9e9cfd562211a0a70bd80b9107542b57a9cb47289d","observation_id":"693fa584-bcd5-4a42-a964-5d1b8868bed6","resolution":{"observed_at":"2026-08-07T14:34:40.153392Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2309.12881","last_updated":"2024-08-05T12:13:39Z","snapshot_observed_at":"2026-07-06T16:22:21.746857Z","submitted_at":"2023-09-22T14:11:23Z","title":"Affect Recognition in Conversations Using Large Language Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2309.12881","snapshot_observed_at":"2026-08-07T14:34:40.081413Z","title":"Af- fect recognition in conversations using large language models,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.18484","last_updated":"2025-05-24T03:16:21Z","snapshot_observed_at":"2026-08-07T14:28:31.931608Z","submitted_at":"2025-05-24T03:16:21Z","title":"Token-Level Logits Matter: A Closer Look at Speech Foundation Models for Ambiguous Emotion Recognition","version":1},"reference_index":37,"source":"pdf_text","source_observed_at":"2026-08-07T14:34:40.081413Z"},"links":{"cited_paper":"/paper/2309.12881","citing_paper":"/paper/2505.18484"},"observation_digest":"sha256:84bb0f494d28bb953328725478f096b977cb4a6dd304a247c829672dcde73b1f","observation_id":"41b265b3-2616-44ec-888b-d2551d89d260","resolution":{"observed_at":"2026-08-07T14:34:40.081413Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"paper":{"arxiv_id":"2505.18484","last_updated":"2025-05-24T03:16:21Z","latest_version":1,"primary_category":"cs.SD","snapshot_observed_at":"2026-08-07T14:28:31.931608Z","submitted_at":"2025-05-24T03:16:21Z","title":"Token-Level Logits Matter: A Closer Look at Speech Foundation Models for Ambiguous Emotion Recognition"},"reference_resolution":{"displayed":36,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":1,"unresolved":7,"verified_exact":1,"verified_fuzzy":27},"total_outbound_references":36},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"thesis":"As of 10 August 2026, this Paper Citation Record lists 36 of 36 outbound references and 2 inbound Pith citation observations for arXiv:2505.18484."}