{"as_of":"2026-08-15T04:02:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:9ef2c37b60a9cdb00696550c8241bd8042366ad3994abf75c8497b7bf265bdaf","coverage":[{"denominator":39,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":39,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-07T15:09:28.386700Z","state":"measured"},{"denominator":42,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":42,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-14T06:32:32.682623+00:00","state":"measured"},{"denominator":3,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":3,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-07T15:09:23.482691Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":1,"source":"arxiv_reference","source_observed_at":"2026-08-05T02:28:24.338817Z","state":"measured"}],"external_citation_measurements":[{"count":0,"observed_at":"2026-08-05T02:28:24.338817Z","source":"arxiv_reference"}],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2505.16220","last_updated":"2025-05-22T04:44:20Z","snapshot_observed_at":"2026-08-12T08:53:48.715992Z","submitted_at":"2025-05-22T04:44:20Z","title":"Meta-PerSER: Few-Shot Listener Personalized Speech Emotion Recognition via Meta-learning","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2505.16220","snapshot_observed_at":"2026-08-07T15:09:23.482691Z","title":"Despite substan- tial progress with deep learning, SER remains challenging due to the complexity of emotional expressions and the subjectivity of emotion perception [4]","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2505.16220","last_updated":"2025-05-22T04:44:20Z","snapshot_observed_at":"2026-08-12T08:53:48.715992Z","submitted_at":"2025-05-22T04:44:20Z","title":"Meta-PerSER: Few-Shot Listener Personalized Speech Emotion Recognition via Meta-learning","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-07T15:09:23.482691Z"},"links":{"cited_paper":"/paper/2505.16220","citing_paper":"/paper/2505.16220"},"observation_digest":"sha256:81ea4a8e888f80d2923b91c35bae19e8254588b6a37c6f1503c8ee9f503a4a05","observation_id":"ecaa7c47-827e-4368-8e54-5bfd8e07e92f","resolution":{"observed_at":"2026-08-07T15:09:23.482691Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2505.16220","last_updated":"2025-05-22T04:44:20Z","snapshot_observed_at":"2026-08-12T08:53:48.715992Z","submitted_at":"2025-05-22T04:44:20Z","title":"Meta-PerSER: Few-Shot Listener Personalized Speech Emotion Recognition via Meta-learning","version":1},"cited_work":{"arxiv_id":"2505.16220","doi":"10.48550/arxiv.2505.16220","metadata_source":"arxiv_reference","pith_arxiv_id":"2505.16220","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Meta-perser: Few-shot listener personalized speech emotion recognition via meta-learning","venue":"ArXiv.org","work_id":"4999609f-4f60-454d-94a5-28d2fb6acf78","year":2025},"citing_paper":{"arxiv_id":"2605.03039","last_updated":"2026-05-04T18:06:17Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2026-05-04T18:06:17Z","title":"Mixed-Precision Information Bottlenecks for On-Device Trait-State Disentanglement in Bipolar Agitation Detection","version":1},"reference_index":93,"source":"arxiv_source","source_observed_at":"2026-05-08T19:11:30.638672Z"},"links":{"cited_paper":"/paper/2505.16220","citing_paper":"/paper/2605.03039"},"observation_digest":"sha256:0c65a4f3df67990c78a63cca195746eef4aeb8633ea356717da38d6dd2120872","observation_id":"683bc5d7-4f13-4b73-9ec5-28c656249489","resolution":{"observed_at":"2026-05-09T06:00:36.697028Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2505.16220","last_updated":"2025-05-22T04:44:20Z","snapshot_observed_at":"2026-08-12T08:53:48.715992Z","submitted_at":"2025-05-22T04:44:20Z","title":"Meta-PerSER: Few-Shot Listener Personalized Speech Emotion Recognition via Meta-learning","version":1},"cited_work":{"arxiv_id":"2505.16220","doi":"10.48550/arxiv.2505.16220","metadata_source":"arxiv_reference","pith_arxiv_id":"2505.16220","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Meta-perser: Few-shot listener personalized speech emotion recognition via meta-learning","venue":"ArXiv.org","work_id":"4999609f-4f60-454d-94a5-28d2fb6acf78","year":2025},"citing_paper":{"arxiv_id":"2606.11219","last_updated":"2026-05-11T20:27:40Z","snapshot_observed_at":"2026-08-05T20:46:41.277498Z","submitted_at":"2026-05-11T20:27:40Z","title":"Afrispeech Semantics: Evaluating Audio Semantic Reasoning in Spoken Language Models Across Domains and Accents","version":1},"reference_index":236,"source":"arxiv_source","source_observed_at":"2026-06-30T22:11:44.891731Z"},"links":{"cited_paper":"/paper/2505.16220","citing_paper":"/paper/2606.11219"},"observation_digest":"sha256:038ef21cc524f013f2ff9d3acddd499ecf32a19a5d22fb82fcf4394340290ba2","observation_id":"0a24cfb7-9a25-414f-8cfb-eac97702ed2c","resolution":{"observed_at":"2026-06-30T22:15:05.601545Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}}],"links":{"evidence":"/evidence","html":"/paper/2505.16220/citation-record","integrity":"/paper/2505.16220/integrity","json":"/paper/2505.16220/citation-record.json","paper":"/paper/2505.16220"},"outbound":[{"citation":{"cited_paper":{"arxiv_id":"2505.16220","last_updated":"2025-05-22T04:44:20Z","snapshot_observed_at":"2026-08-12T08:53:48.715992Z","submitted_at":"2025-05-22T04:44:20Z","title":"Meta-PerSER: Few-Shot Listener Personalized Speech Emotion Recognition via Meta-learning","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2505.16220","snapshot_observed_at":"2026-08-07T15:09:23.482691Z","title":"Despite substan- tial progress with deep learning, SER remains challenging due to the complexity of emotional expressions and the subjectivity of emotion perception [4]","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2505.16220","last_updated":"2025-05-22T04:44:20Z","snapshot_observed_at":"2026-08-12T08:53:48.715992Z","submitted_at":"2025-05-22T04:44:20Z","title":"Meta-PerSER: Few-Shot Listener Personalized Speech Emotion Recognition via Meta-learning","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-07T15:09:23.482691Z"},"links":{"cited_paper":"/paper/2505.16220","citing_paper":"/paper/2505.16220"},"observation_digest":"sha256:81ea4a8e888f80d2923b91c35bae19e8254588b6a37c6f1503c8ee9f503a4a05","observation_id":"ecaa7c47-827e-4368-8e54-5bfd8e07e92f","resolution":{"observed_at":"2026-08-07T15:09:23.482691Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:09:36.171478Z","title":"Backbone SER Framework We employ a unified model architecture based on the s3prl toolkit [25]","venue":null,"work_id":"0d75b962-2ce5-46e7-98b9-5fe7793db145","year":null},"citing_paper":{"arxiv_id":"2505.16220","last_updated":"2025-05-22T04:44:20Z","snapshot_observed_at":"2026-08-12T08:53:48.715992Z","submitted_at":"2025-05-22T04:44:20Z","title":"Meta-PerSER: Few-Shot Listener Personalized Speech Emotion Recognition via Meta-learning","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-07T15:09:23.544628Z"},"links":{"citing_paper":"/paper/2505.16220"},"observation_digest":"sha256:5ca2c838163d71d6e1a21e80edbcd236a737c72fd78fa9dd09f13765fe0ff96e","observation_id":"a2a68036-7bbd-4473-821a-d7598f049aea","resolution":{"observed_at":"2026-08-07T15:09:36.225641Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:09:36.015051Z","title":"other.” We exclude the “other","venue":null,"work_id":"4153f3e9-396e-446d-8b2b-f369ef832f5a","year":null},"citing_paper":{"arxiv_id":"2505.16220","last_updated":"2025-05-22T04:44:20Z","snapshot_observed_at":"2026-08-12T08:53:48.715992Z","submitted_at":"2025-05-22T04:44:20Z","title":"Meta-PerSER: Few-Shot Listener Personalized Speech Emotion Recognition via Meta-learning","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-07T15:09:23.654968Z"},"links":{"citing_paper":"/paper/2505.16220"},"observation_digest":"sha256:bc82163367107172b4e3fb6bcabbb13b36b3e74a215feebe7ab396ab061efea1","observation_id":"7a2ab609-3a2e-4913-bfc2-a17f326fbb62","resolution":{"observed_at":"2026-08-07T15:09:36.082426Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:09:35.845433Z","title":"Proposed Meta-PerSER Table 1 demonstrates that Meta-PerSER consistently outper- forms all baseline methods across both Seen and Unseen Data scenarios and across all upstream models","venue":null,"work_id":"7631fbc4-2b40-4a3a-8317-36fe2bf6814f","year":null},"citing_paper":{"arxiv_id":"2505.16220","last_updated":"2025-05-22T04:44:20Z","snapshot_observed_at":"2026-08-12T08:53:48.715992Z","submitted_at":"2025-05-22T04:44:20Z","title":"Meta-PerSER: Few-Shot Listener Personalized Speech Emotion Recognition via Meta-learning","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-07T15:09:23.773414Z"},"links":{"citing_paper":"/paper/2505.16220"},"observation_digest":"sha256:3b926cb337e3bf623b1bdce144fb1a3f54bdc30e44ec413cc62405a56ae711a2","observation_id":"a2d022cc-adec-47b1-9025-17b664acc572","resolution":{"observed_at":"2026-08-07T15:09:35.934863Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:09:35.665759Z","title":null,"venue":null,"work_id":"992cba9b-3abf-41ee-a12b-9c3c4b68717d","year":null},"citing_paper":{"arxiv_id":"2505.16220","last_updated":"2025-05-22T04:44:20Z","snapshot_observed_at":"2026-08-12T08:53:48.715992Z","submitted_at":"2025-05-22T04:44:20Z","title":"Meta-PerSER: Few-Shot Listener Personalized Speech Emotion Recognition via Meta-learning","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-07T15:09:23.940640Z"},"links":{"citing_paper":"/paper/2505.16220"},"observation_digest":"sha256:cfdf11175c1784999bd4a59ac670b2a0b4f6d4097273e0bf100b4a6d32dec9fa","observation_id":"764b443b-6373-4165-95d3-e61cf8a04097","resolution":{"observed_at":"2026-08-07T15:09:35.732571Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:09:35.507545Z","title":"Meta-PerSER integrates a pre-trained self-supervised backbone with Combined-Set Meta- Training, Derivative Annealing, and per-layer adaptive learning rates","venue":null,"work_id":"c7e9c979-50de-42a5-bf94-3d0898126e4e","year":null},"citing_paper":{"arxiv_id":"2505.16220","last_updated":"2025-05-22T04:44:20Z","snapshot_observed_at":"2026-08-12T08:53:48.715992Z","submitted_at":"2025-05-22T04:44:20Z","title":"Meta-PerSER: Few-Shot Listener Personalized Speech Emotion Recognition via Meta-learning","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-07T15:09:24.060331Z"},"links":{"citing_paper":"/paper/2505.16220"},"observation_digest":"sha256:dfa604d7d72ed8fb535007e8833237bb2c3d8266f852e2bcefd9d7a05dddac70","observation_id":"99841a1e-c773-4ab1-8d11-0581f2d683cb","resolution":{"observed_at":"2026-08-07T15:09:35.580645Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:09:35.315261Z","title":"Speech emotion recognition combining acoustic features and linguistic information in a hy- brid support vector machine-belief network architecture,","venue":null,"work_id":"182e88ce-88b8-4d57-b0ae-4f410e800252","year":2004},"citing_paper":{"arxiv_id":"2505.16220","last_updated":"2025-05-22T04:44:20Z","snapshot_observed_at":"2026-08-12T08:53:48.715992Z","submitted_at":"2025-05-22T04:44:20Z","title":"Meta-PerSER: Few-Shot Listener Personalized Speech Emotion Recognition via Meta-learning","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-07T15:09:24.212370Z"},"links":{"citing_paper":"/paper/2505.16220"},"observation_digest":"sha256:36d6a3cd888ec226e57192b443f8065375702ea7505cb08fe0f4de60338f45c6","observation_id":"09044711-7e64-47fb-a00c-7ce5c7350f2b","resolution":{"observed_at":"2026-08-07T15:09:35.416286Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:09:35.133454Z","title":"Speech Emotion Recognition Using Deep Learn- ing Techniques: A Review,","venue":null,"work_id":"49953b1a-104c-4c50-bbf0-cdfb200eaf94","year":2019},"citing_paper":{"arxiv_id":"2505.16220","last_updated":"2025-05-22T04:44:20Z","snapshot_observed_at":"2026-08-12T08:53:48.715992Z","submitted_at":"2025-05-22T04:44:20Z","title":"Meta-PerSER: Few-Shot Listener Personalized Speech Emotion Recognition via Meta-learning","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-07T15:09:24.372886Z"},"links":{"citing_paper":"/paper/2505.16220"},"observation_digest":"sha256:edc2857f68eb6d7df92d7b03029c91a9d71ad071674051ea33697e560c4af474","observation_id":"f7121961-ccf2-4346-a129-e63f11d6825f","resolution":{"observed_at":"2026-08-07T15:09:35.223662Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:09:34.935572Z","title":"Speech Emotion Recognition with Fusion of Acoustic- and Linguistic-Feature- Based Decisions,","venue":null,"work_id":"a0d5eb50-3697-4045-b504-4ce37975cac9","year":2021},"citing_paper":{"arxiv_id":"2505.16220","last_updated":"2025-05-22T04:44:20Z","snapshot_observed_at":"2026-08-12T08:53:48.715992Z","submitted_at":"2025-05-22T04:44:20Z","title":"Meta-PerSER: Few-Shot Listener Personalized Speech Emotion Recognition via Meta-learning","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-07T15:09:24.504122Z"},"links":{"citing_paper":"/paper/2505.16220"},"observation_digest":"sha256:a08b7904697f78b517360c3304b5d54ac4ef76f97883297b0252b727d2b21de4","observation_id":"a15afbb7-abec-4c16-b06a-e9961507c104","resolution":{"observed_at":"2026-08-07T15:09:35.029795Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:09:34.796123Z","title":"EMO-Codec: An In-Depth Look at Emotion Preservation Capacity of Legacy and Neural Codec Models with Subjective and Objective Evaluations,","venue":null,"work_id":"50c4cd70-7aa8-43a7-9ebd-fe56fc09c1d5","year":2024},"citing_paper":{"arxiv_id":"2505.16220","last_updated":"2025-05-22T04:44:20Z","snapshot_observed_at":"2026-08-12T08:53:48.715992Z","submitted_at":"2025-05-22T04:44:20Z","title":"Meta-PerSER: Few-Shot Listener Personalized Speech Emotion Recognition via Meta-learning","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-07T15:09:24.618688Z"},"links":{"citing_paper":"/paper/2505.16220"},"observation_digest":"sha256:00e5fcf3b60483b23018e9e4cc68760ae162a005dca24355ab694eb224bc6fb0","observation_id":"c7ab34d7-b9eb-49a3-86cb-c8ad2a1785d6","resolution":{"observed_at":"2026-08-07T15:09:34.858958Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:09:34.633106Z","title":"Interpreting ambiguous emotional expressions,","venue":null,"work_id":"2a11a159-c7d2-4e3f-b457-680d82c5807f","year":2009},"citing_paper":{"arxiv_id":"2505.16220","last_updated":"2025-05-22T04:44:20Z","snapshot_observed_at":"2026-08-12T08:53:48.715992Z","submitted_at":"2025-05-22T04:44:20Z","title":"Meta-PerSER: Few-Shot Listener Personalized Speech Emotion Recognition via Meta-learning","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-07T15:09:24.761531Z"},"links":{"citing_paper":"/paper/2505.16220"},"observation_digest":"sha256:6792b823e9c2b6fa4a19fb87c030d922e5aebdff2d3b323e17922e026530fcd4","observation_id":"7dc1b3bc-e465-42cf-a8d4-1385527c3c73","resolution":{"observed_at":"2026-08-07T15:09:34.699354Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1909.00360","last_updated":"2019-09-01T09:05:58Z","snapshot_observed_at":"2026-08-14T05:52:41.281747Z","submitted_at":"2019-09-01T09:05:58Z","title":"The Ambiguous World of Emotion Representation","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1909.00360","snapshot_observed_at":"2026-08-07T15:09:24.902229Z","title":"The Ambiguous World of Emotion Representation,","venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2505.16220","last_updated":"2025-05-22T04:44:20Z","snapshot_observed_at":"2026-08-12T08:53:48.715992Z","submitted_at":"2025-05-22T04:44:20Z","title":"Meta-PerSER: Few-Shot Listener Personalized Speech Emotion Recognition via Meta-learning","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-07T15:09:24.902229Z"},"links":{"cited_paper":"/paper/1909.00360","citing_paper":"/paper/2505.16220"},"observation_digest":"sha256:11d52f9d96217799a6e4a8a4d9d91abe51ce941aa7a4e380621f4694f7cc0e05","observation_id":"6a84702f-8403-4d32-a0ea-222621795bcb","resolution":{"observed_at":"2026-08-07T15:09:24.902229Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:09:34.448364Z","title":"Speaker Attentive Speech Emotion Recognition,","venue":null,"work_id":"60804680-e690-4bb6-918d-cf58c0a03c18","year":2021},"citing_paper":{"arxiv_id":"2505.16220","last_updated":"2025-05-22T04:44:20Z","snapshot_observed_at":"2026-08-12T08:53:48.715992Z","submitted_at":"2025-05-22T04:44:20Z","title":"Meta-PerSER: Few-Shot Listener Personalized Speech Emotion Recognition via Meta-learning","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-07T15:09:25.006797Z"},"links":{"citing_paper":"/paper/2505.16220"},"observation_digest":"sha256:12fb4b44e19e3b537048e7c4c0477c12f0c737807db9cc582b933e7f7ae3213e","observation_id":"47a10a85-eb28-4209-b7fc-ff148de5fd7c","resolution":{"observed_at":"2026-08-07T15:09:34.545899Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:09:34.291214Z","title":"Personalized Adapta- tion with Pre-trained Speech Encoders for Continuous Emotion Recognition,","venue":null,"work_id":"72167d6f-76d0-41a3-a518-cc7e03da407f","year":2023},"citing_paper":{"arxiv_id":"2505.16220","last_updated":"2025-05-22T04:44:20Z","snapshot_observed_at":"2026-08-12T08:53:48.715992Z","submitted_at":"2025-05-22T04:44:20Z","title":"Meta-PerSER: Few-Shot Listener Personalized Speech Emotion Recognition via Meta-learning","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-07T15:09:25.117728Z"},"links":{"citing_paper":"/paper/2505.16220"},"observation_digest":"sha256:0e1264c227f18ca834be9583207cd3a84e6010e3b2ce8c1763503733639affa6","observation_id":"eeac684d-bbe6-4ffd-90fa-b59e9034574b","resolution":{"observed_at":"2026-08-07T15:09:34.348824Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:09:34.160544Z","title":"The “Problem","venue":null,"work_id":"b3b1be8a-888e-4a1a-9ada-e099c7036ceb","year":2022},"citing_paper":{"arxiv_id":"2505.16220","last_updated":"2025-05-22T04:44:20Z","snapshot_observed_at":"2026-08-12T08:53:48.715992Z","submitted_at":"2025-05-22T04:44:20Z","title":"Meta-PerSER: Few-Shot Listener Personalized Speech Emotion Recognition via Meta-learning","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-07T15:09:25.239183Z"},"links":{"citing_paper":"/paper/2505.16220"},"observation_digest":"sha256:145e210928847ad9035fd1161578fd1eea2d4e23ead051841e72bbf3a0311d0e","observation_id":"612d0aa4-429b-45f9-8201-82504ff89a89","resolution":{"observed_at":"2026-08-07T15:09:34.214333Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:09:33.939486Z","title":"DICES Dataset: Diversity in Conversational AI Evaluation for Safety,","venue":null,"work_id":"f60edca2-7031-4b74-ad82-2083aa0f0f74","year":2023},"citing_paper":{"arxiv_id":"2505.16220","last_updated":"2025-05-22T04:44:20Z","snapshot_observed_at":"2026-08-12T08:53:48.715992Z","submitted_at":"2025-05-22T04:44:20Z","title":"Meta-PerSER: Few-Shot Listener Personalized Speech Emotion Recognition via Meta-learning","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-07T15:09:25.382377Z"},"links":{"citing_paper":"/paper/2505.16220"},"observation_digest":"sha256:95af173071cdfd35a61f7771495e4af329f3ecb0efa2f9dbb5d7197991550111","observation_id":"37054a00-36a1-4ebf-bfc7-320c2cf313d6","resolution":{"observed_at":"2026-08-07T15:09:34.054503Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:09:33.804125Z","title":"On Re- leasing Annotator-Level Labels and Information in Datasets,","venue":null,"work_id":"e40c16d3-47c4-4d04-8a68-1edc1c437f31","year":2021},"citing_paper":{"arxiv_id":"2505.16220","last_updated":"2025-05-22T04:44:20Z","snapshot_observed_at":"2026-08-12T08:53:48.715992Z","submitted_at":"2025-05-22T04:44:20Z","title":"Meta-PerSER: Few-Shot Listener Personalized Speech Emotion Recognition via Meta-learning","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-07T15:09:25.514058Z"},"links":{"citing_paper":"/paper/2505.16220"},"observation_digest":"sha256:93608441cc6f753df49934b231c46c1aa2612380eb4101fd8023becaf2e3c804","observation_id":"05c512d8-b149-4ba7-802b-da4e402aa0f4","resolution":{"observed_at":"2026-08-07T15:09:33.857690Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:09:33.622016Z","title":"Open-Emotion: A Reproducible EMO-Superb For Speech Emotion Recognition Systems,","venue":null,"work_id":"49fd9236-1c10-4d31-9b1f-ad514783c04e","year":2024},"citing_paper":{"arxiv_id":"2505.16220","last_updated":"2025-05-22T04:44:20Z","snapshot_observed_at":"2026-08-12T08:53:48.715992Z","submitted_at":"2025-05-22T04:44:20Z","title":"Meta-PerSER: Few-Shot Listener Personalized Speech Emotion Recognition via Meta-learning","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-07T15:09:25.654630Z"},"links":{"citing_paper":"/paper/2505.16220"},"observation_digest":"sha256:2afb6ed8dd48733942b350ff68a23baf5f7db2efb95cb19ab762d59da678cb39","observation_id":"33ae503b-aeb8-4a90-be21-ca083732fc4f","resolution":{"observed_at":"2026-08-07T15:09:33.708913Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:09:33.506042Z","title":"Every Rating Matters: Joint Learn- ing of Subjective Labels and Individual Annotators for Speech Emotion Classification,","venue":null,"work_id":"fe3a7327-cd17-4990-8cbd-e5ae54d20f8c","year":2019},"citing_paper":{"arxiv_id":"2505.16220","last_updated":"2025-05-22T04:44:20Z","snapshot_observed_at":"2026-08-12T08:53:48.715992Z","submitted_at":"2025-05-22T04:44:20Z","title":"Meta-PerSER: Few-Shot Listener Personalized Speech Emotion Recognition via Meta-learning","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-07T15:09:25.792885Z"},"links":{"citing_paper":"/paper/2505.16220"},"observation_digest":"sha256:503c27c523129eb5bd93267319d90cf23c8a55393afe2763cf88cfecc3d8241c","observation_id":"ee086334-d68c-4754-b5e3-508455a77c9d","resolution":{"observed_at":"2026-08-07T15:09:33.560933Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:09:33.343850Z","title":"Dealing with Dis- agreements: Looking Beyond the Majority V ote in Subjective Annotations,","venue":null,"work_id":"bd87957b-2d66-42a6-af32-5627a43bf165","year":2022},"citing_paper":{"arxiv_id":"2505.16220","last_updated":"2025-05-22T04:44:20Z","snapshot_observed_at":"2026-08-12T08:53:48.715992Z","submitted_at":"2025-05-22T04:44:20Z","title":"Meta-PerSER: Few-Shot Listener Personalized Speech Emotion Recognition via Meta-learning","version":1},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-07T15:09:25.914974Z"},"links":{"citing_paper":"/paper/2505.16220"},"observation_digest":"sha256:bc5df35447faf210c14b03ccd5113f996698ac1dcb6ab0c1bc87e50757a58c78","observation_id":"edd9bd00-aae3-4b9a-ac2b-37425e7b7116","resolution":{"observed_at":"2026-08-07T15:09:33.439858Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:09:33.053316Z","title":"Meta- Learning in Neural Networks: A Survey,","venue":null,"work_id":"f4eed59a-c930-4672-b170-38a562db967d","year":2022},"citing_paper":{"arxiv_id":"2505.16220","last_updated":"2025-05-22T04:44:20Z","snapshot_observed_at":"2026-08-12T08:53:48.715992Z","submitted_at":"2025-05-22T04:44:20Z","title":"Meta-PerSER: Few-Shot Listener Personalized Speech Emotion Recognition via Meta-learning","version":1},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-07T15:09:26.017141Z"},"links":{"citing_paper":"/paper/2505.16220"},"observation_digest":"sha256:11c121e1f72bd56a74a050dc91741275dbf93794822587315914d284fcd4e80f","observation_id":"d89b476b-f03b-4402-bae4-199196b66a55","resolution":{"observed_at":"2026-08-07T15:09:33.160134Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:09:26.124390Z","title":"Model-agnostic meta-learning for fast adaptation of deep networks,","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2505.16220","last_updated":"2025-05-22T04:44:20Z","snapshot_observed_at":"2026-08-12T08:53:48.715992Z","submitted_at":"2025-05-22T04:44:20Z","title":"Meta-PerSER: Few-Shot Listener Personalized Speech Emotion Recognition via Meta-learning","version":1},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-07T15:09:26.124390Z"},"links":{"citing_paper":"/paper/2505.16220"},"observation_digest":"sha256:28448d0a9dfca2a19800d843b9e318944515aede26a6e6f98202efeff8dc3d74","observation_id":"1075fe1d-4524-4132-bb51-d908ee6451c8","resolution":{"observed_at":"2026-08-07T15:09:26.124390Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:09:32.701207Z","title":"Optimization as a Model for Few- Shot Learning,","venue":null,"work_id":"a0467f25-4f3f-467e-8a4d-b5ca5028b6e4","year":2017},"citing_paper":{"arxiv_id":"2505.16220","last_updated":"2025-05-22T04:44:20Z","snapshot_observed_at":"2026-08-12T08:53:48.715992Z","submitted_at":"2025-05-22T04:44:20Z","title":"Meta-PerSER: Few-Shot Listener Personalized Speech Emotion Recognition via Meta-learning","version":1},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-07T15:09:26.229399Z"},"links":{"citing_paper":"/paper/2505.16220"},"observation_digest":"sha256:9c63b93e7fc1f63e7e875d231a1b3919ce61a7374cb186ae2189eba0cf7d3184","observation_id":"29b61794-18d6-4812-930e-10103b51ee56","resolution":{"observed_at":"2026-08-07T15:09:32.862748Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:09:32.414867Z","title":"Meta-Learning for Speech Emotion Recognition Considering Ambiguity of Emotion Labels,","venue":null,"work_id":"acd00d40-3a0a-4bc7-9877-84f4b5f32cb5","year":2020},"citing_paper":{"arxiv_id":"2505.16220","last_updated":"2025-05-22T04:44:20Z","snapshot_observed_at":"2026-08-12T08:53:48.715992Z","submitted_at":"2025-05-22T04:44:20Z","title":"Meta-PerSER: Few-Shot Listener Personalized Speech Emotion Recognition via Meta-learning","version":1},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-07T15:09:26.349187Z"},"links":{"citing_paper":"/paper/2505.16220"},"observation_digest":"sha256:63bf0c06b406443a03a948a2a3665642f5892baa60f246f0550a8e29ffb56998","observation_id":"c5e40ac8-04bb-4e51-b545-cd0961ed4f06","resolution":{"observed_at":"2026-08-07T15:09:32.583112Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:09:32.146622Z","title":"Meta- Learning for Low-Resource Speech Emotion Recognition,","venue":null,"work_id":"aabdcd23-fb4b-4a19-a39e-12d324ef633e","year":2021},"citing_paper":{"arxiv_id":"2505.16220","last_updated":"2025-05-22T04:44:20Z","snapshot_observed_at":"2026-08-12T08:53:48.715992Z","submitted_at":"2025-05-22T04:44:20Z","title":"Meta-PerSER: Few-Shot Listener Personalized Speech Emotion Recognition via Meta-learning","version":1},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-08-07T15:09:26.473567Z"},"links":{"citing_paper":"/paper/2505.16220"},"observation_digest":"sha256:40fdc99cc6a93fbd445089796357b79b2d845371b6dd0e4d812cc8660ce7bc9a","observation_id":"cbc67106-18e7-49ba-903b-e00bafc7d770","resolution":{"observed_at":"2026-08-07T15:09:32.266809Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:09:31.847571Z","title":"Dealing with Dis- agreements: Looking Beyond the Majority V ote in Subjective Annotations,","venue":null,"work_id":"e51ea970-8c0a-4368-a0f5-ebf3b5de0b4a","year":2022},"citing_paper":{"arxiv_id":"2505.16220","last_updated":"2025-05-22T04:44:20Z","snapshot_observed_at":"2026-08-12T08:53:48.715992Z","submitted_at":"2025-05-22T04:44:20Z","title":"Meta-PerSER: Few-Shot Listener Personalized Speech Emotion Recognition via Meta-learning","version":1},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-08-07T15:09:26.610321Z"},"links":{"citing_paper":"/paper/2505.16220"},"observation_digest":"sha256:359b89ab31fb4592f8669742e89586fc56e7e9a1c3ac33470d67c6119e6d5467","observation_id":"8baf4a67-9bf7-4dd7-9667-7ca72a788dfa","resolution":{"observed_at":"2026-08-07T15:09:32.009550Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:09:31.581817Z","title":"Speech emotion recognition based on meta-transfer learning with domain adaption,","venue":null,"work_id":"e4f0b523-6c23-4d88-9edd-6e8ead58d5c5","year":2023},"citing_paper":{"arxiv_id":"2505.16220","last_updated":"2025-05-22T04:44:20Z","snapshot_observed_at":"2026-08-12T08:53:48.715992Z","submitted_at":"2025-05-22T04:44:20Z","title":"Meta-PerSER: Few-Shot Listener Personalized Speech Emotion Recognition via Meta-learning","version":1},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-08-07T15:09:26.735695Z"},"links":{"citing_paper":"/paper/2505.16220"},"observation_digest":"sha256:6d3e5e2122333b73463095ba8a3dedf089bae6f82e4ee5d478dc0d738fc4590d","observation_id":"31b04a2c-4be4-4134-911f-89e228f0297d","resolution":{"observed_at":"2026-08-07T15:09:31.730538Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:09:31.280475Z","title":"On efficacy of Meta-Learning for Domain Generalization in Speech Emotion Recognition,","venue":null,"work_id":"5a5a68f3-9586-4c8f-9df2-523507c55ac4","year":2023},"citing_paper":{"arxiv_id":"2505.16220","last_updated":"2025-05-22T04:44:20Z","snapshot_observed_at":"2026-08-12T08:53:48.715992Z","submitted_at":"2025-05-22T04:44:20Z","title":"Meta-PerSER: Few-Shot Listener Personalized Speech Emotion Recognition via Meta-learning","version":1},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-08-07T15:09:26.875962Z"},"links":{"citing_paper":"/paper/2505.16220"},"observation_digest":"sha256:cc4bbe207af5842317bf364956d7ba82b765bb8cfebd5fce719949b1ff73d6b3","observation_id":"8a12fb9a-39c1-45ec-be76-cf8199f95d97","resolution":{"observed_at":"2026-08-07T15:09:31.444958Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:09:30.997728Z","title":"Learning to Recognize Per-Rater’s Emotion Perception Using Co-Rater Training Strategy with Soft and Hard Labels,","venue":null,"work_id":"a0a89ce2-fd87-4bf9-a8e8-095c490b958d","year":2020},"citing_paper":{"arxiv_id":"2505.16220","last_updated":"2025-05-22T04:44:20Z","snapshot_observed_at":"2026-08-12T08:53:48.715992Z","submitted_at":"2025-05-22T04:44:20Z","title":"Meta-PerSER: Few-Shot Listener Personalized Speech Emotion Recognition via Meta-learning","version":1},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-08-07T15:09:26.997422Z"},"links":{"citing_paper":"/paper/2505.16220"},"observation_digest":"sha256:3f7051731e9bcfd2da6adcffbc14bff5499d0f4610f3205dbe13a15ef093ac98","observation_id":"49c444e8-b95b-426a-966e-f3b71ef5d1b8","resolution":{"observed_at":"2026-08-07T15:09:31.115676Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:09:30.711580Z","title":"IEMOCAP: Interactive emotional dyadic motion capture database,","venue":null,"work_id":"290ad510-d58a-4b0b-9c64-5fd931cb6e5f","year":2008},"citing_paper":{"arxiv_id":"2505.16220","last_updated":"2025-05-22T04:44:20Z","snapshot_observed_at":"2026-08-12T08:53:48.715992Z","submitted_at":"2025-05-22T04:44:20Z","title":"Meta-PerSER: Few-Shot Listener Personalized Speech Emotion Recognition via Meta-learning","version":1},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-08-07T15:09:27.127918Z"},"links":{"citing_paper":"/paper/2505.16220"},"observation_digest":"sha256:4d7a747d667086ee0eb450ba65d4861160f61a5a9f8fef263441623a3946f060","observation_id":"37ea7bbf-d707-4138-9b1c-172197fc2ed9","resolution":{"observed_at":"2026-08-07T15:09:30.863409Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:09:27.305920Z","title":"SUPERB: Speech Processing Universal PERformance Benchmark,","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2505.16220","last_updated":"2025-05-22T04:44:20Z","snapshot_observed_at":"2026-08-12T08:53:48.715992Z","submitted_at":"2025-05-22T04:44:20Z","title":"Meta-PerSER: Few-Shot Listener Personalized Speech Emotion Recognition via Meta-learning","version":1},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-08-07T15:09:27.305920Z"},"links":{"citing_paper":"/paper/2505.16220"},"observation_digest":"sha256:d3714aba03d40be04d2bec1abdaba85f7247807b1d211b9dadf2098588526b2d","observation_id":"a76636bf-08d4-452d-bba5-e405d48764a8","resolution":{"observed_at":"2026-08-07T15:09:27.305920Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:09:30.400602Z","title":"wav2vec 2.0: a framework for self-supervised learning of speech representa- tions,","venue":null,"work_id":"c7ac6379-492b-404b-bad5-3ced97e6e8a2","year":2020},"citing_paper":{"arxiv_id":"2505.16220","last_updated":"2025-05-22T04:44:20Z","snapshot_observed_at":"2026-08-12T08:53:48.715992Z","submitted_at":"2025-05-22T04:44:20Z","title":"Meta-PerSER: Few-Shot Listener Personalized Speech Emotion Recognition via Meta-learning","version":1},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-08-07T15:09:27.463252Z"},"links":{"citing_paper":"/paper/2505.16220"},"observation_digest":"sha256:324f71129928fa9063a4f1c0e0627b5cb8d5166a83ae3e9ca6f62269176524da","observation_id":"c30a1408-254a-448e-9e31-0e405344efd9","resolution":{"observed_at":"2026-08-07T15:09:30.567152Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:09:30.088574Z","title":"HuBERT: Self-Supervised Speech Rep- resentation Learning by Masked Prediction of Hidden Units,","venue":null,"work_id":"9036bd4e-7f7c-4a6a-9878-a1ed60355c8e","year":2021},"citing_paper":{"arxiv_id":"2505.16220","last_updated":"2025-05-22T04:44:20Z","snapshot_observed_at":"2026-08-12T08:53:48.715992Z","submitted_at":"2025-05-22T04:44:20Z","title":"Meta-PerSER: Few-Shot Listener Personalized Speech Emotion Recognition via Meta-learning","version":1},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-08-07T15:09:27.585621Z"},"links":{"citing_paper":"/paper/2505.16220"},"observation_digest":"sha256:677b759b563071f6c2f7d282493432328b11ecce730f2e4a1313be4c15ea9a47","observation_id":"a5fa9ae3-f087-42f2-8fa1-ee772ad1990a","resolution":{"observed_at":"2026-08-07T15:09:30.190577Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:09:29.720568Z","title":"WavLM: Large-Scale Self-Supervised Pre- Training for Full Stack Speech Processing,","venue":null,"work_id":"3edd9371-e684-427d-a5d5-347123148d53","year":2022},"citing_paper":{"arxiv_id":"2505.16220","last_updated":"2025-05-22T04:44:20Z","snapshot_observed_at":"2026-08-12T08:53:48.715992Z","submitted_at":"2025-05-22T04:44:20Z","title":"Meta-PerSER: Few-Shot Listener Personalized Speech Emotion Recognition via Meta-learning","version":1},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-08-07T15:09:27.717558Z"},"links":{"citing_paper":"/paper/2505.16220"},"observation_digest":"sha256:7830d214faba5fe23eb0621f4277cede3990d0881be904b0b5f4c0d992b2ebaa","observation_id":"55c61b94-62fe-4784-83cb-e3a0e370e95e","resolution":{"observed_at":"2026-08-07T15:09:29.894914Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:09:29.459705Z","title":"Class- Balanced Loss Based on Effective Number of Samples,","venue":null,"work_id":"189fe270-a198-419b-9ed7-33950006c97b","year":2019},"citing_paper":{"arxiv_id":"2505.16220","last_updated":"2025-05-22T04:44:20Z","snapshot_observed_at":"2026-08-12T08:53:48.715992Z","submitted_at":"2025-05-22T04:44:20Z","title":"Meta-PerSER: Few-Shot Listener Personalized Speech Emotion Recognition via Meta-learning","version":1},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-08-07T15:09:27.832798Z"},"links":{"citing_paper":"/paper/2505.16220"},"observation_digest":"sha256:698a5b0774e56f38625ea00779c6313d6cdcaf6cd45a91dd7fb71d9dfe83607e","observation_id":"0e833bb9-e452-4fad-aecc-31b3161aa58f","resolution":{"observed_at":"2026-08-07T15:09:29.591860Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:09:29.101525Z","title":"How to train your MAML,","venue":null,"work_id":"cd248b52-8640-4685-b02e-7dd89f5fc9fb","year":2019},"citing_paper":{"arxiv_id":"2505.16220","last_updated":"2025-05-22T04:44:20Z","snapshot_observed_at":"2026-08-12T08:53:48.715992Z","submitted_at":"2025-05-22T04:44:20Z","title":"Meta-PerSER: Few-Shot Listener Personalized Speech Emotion Recognition via Meta-learning","version":1},"reference_index":36,"source":"pdf_text","source_observed_at":"2026-08-07T15:09:27.928192Z"},"links":{"citing_paper":"/paper/2505.16220"},"observation_digest":"sha256:a9a365226c6f8db35a9fd1fd0d9f11f2c9eee35681d0da255f2fcbd11ea41ff6","observation_id":"9c949f02-5630-40a6-b272-eb779f2931c6","resolution":{"observed_at":"2026-08-07T15:09:29.267113Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:09:28.848588Z","title":"Few-Shot Acoustic Event Detection Via Meta Learn- ing,","venue":null,"work_id":"0aa9111c-fe00-45d7-a41a-35a3ff97e77e","year":2020},"citing_paper":{"arxiv_id":"2505.16220","last_updated":"2025-05-22T04:44:20Z","snapshot_observed_at":"2026-08-12T08:53:48.715992Z","submitted_at":"2025-05-22T04:44:20Z","title":"Meta-PerSER: Few-Shot Listener Personalized Speech Emotion Recognition via Meta-learning","version":1},"reference_index":37,"source":"pdf_text","source_observed_at":"2026-08-07T15:09:28.067844Z"},"links":{"citing_paper":"/paper/2505.16220"},"observation_digest":"sha256:9c4e7870cf33b94ba8f9135253af61c4f25cd0f359287b56442b8bcfa52eec61","observation_id":"ff40ef00-877f-4d1d-a941-3cccf3aaa559","resolution":{"observed_at":"2026-08-07T15:09:28.971431Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1911.03347","last_updated":"2021-02-08T18:20:55Z","snapshot_observed_at":"2026-08-12T17:42:40.914903Z","submitted_at":"2019-11-08T16:13:54Z","title":"Macro F1 and Macro F1","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1911.03347","snapshot_observed_at":"2026-08-07T15:09:28.255290Z","title":"Macro f1 and macro f1,","venue":null,"work_id":null,"year":1911},"citing_paper":{"arxiv_id":"2505.16220","last_updated":"2025-05-22T04:44:20Z","snapshot_observed_at":"2026-08-12T08:53:48.715992Z","submitted_at":"2025-05-22T04:44:20Z","title":"Meta-PerSER: Few-Shot Listener Personalized Speech Emotion Recognition via Meta-learning","version":1},"reference_index":38,"source":"pdf_text","source_observed_at":"2026-08-07T15:09:28.255290Z"},"links":{"cited_paper":"/paper/1911.03347","citing_paper":"/paper/2505.16220"},"observation_digest":"sha256:f38553873ba45bc4c74079d3dd7dceee208a022af7c8cda8369e662173edcfa2","observation_id":"e3d2a4c4-9b03-44b0-abf8-b2b9e54f1dee","resolution":{"observed_at":"2026-08-07T15:09:28.255290Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:09:28.547945Z","title":"Emo- bias: A large scale evaluation of social bias on speech emotion recognition,","venue":null,"work_id":"303672f2-6e96-4ed0-9e53-91b223ff3b73","year":2024},"citing_paper":{"arxiv_id":"2505.16220","last_updated":"2025-05-22T04:44:20Z","snapshot_observed_at":"2026-08-12T08:53:48.715992Z","submitted_at":"2025-05-22T04:44:20Z","title":"Meta-PerSER: Few-Shot Listener Personalized Speech Emotion Recognition via Meta-learning","version":1},"reference_index":39,"source":"pdf_text","source_observed_at":"2026-08-07T15:09:28.386700Z"},"links":{"citing_paper":"/paper/2505.16220"},"observation_digest":"sha256:730468396e51beda404c422537fcdbc7cd4510ba3a43f9578a82c54f797c3955","observation_id":"a57f0bac-014d-4f3b-8276-070188614498","resolution":{"observed_at":"2026-08-07T15:09:28.665534Z","resolver_source":"raw_fallback","status":"malformed_identifier"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}}],"paper":{"arxiv_id":"2505.16220","last_updated":"2025-05-22T04:44:20Z","latest_version":1,"primary_category":"eess.AS","snapshot_observed_at":"2026-08-12T08:53:48.715992Z","submitted_at":"2025-05-22T04:44:20Z","title":"Meta-PerSER: Few-Shot Listener Personalized Speech Emotion Recognition via Meta-learning"},"reference_resolution":{"displayed":39,"state_counts":{"malformed_identifier":1,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":6,"verified_exact":0,"verified_fuzzy":32},"total_outbound_references":39},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"thesis":"As of 15 August 2026, this Paper Citation Record lists 39 of 39 outbound references and 3 inbound Pith citation observations for arXiv:2505.16220."}