{"as_of":"2026-08-10T10:00:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:350af308a3482643319061ce2f207a64fe3852161f181c3bf7db80bbc717d37a","coverage":[{"denominator":45,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":45,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-07T11:56:05.607696Z","state":"measured"},{"denominator":46,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":46,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-10T06:31:04.303077+00:00","state":"measured"},{"denominator":1,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":1,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-07T11:56:02.131837Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"pith","source_observed_at":"2026-08-07T11:56:06.781642Z","state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2506.02059","last_updated":"2025-06-01T15:49:40Z","snapshot_observed_at":"2026-08-09T16:12:06.482558Z","submitted_at":"2025-06-01T15:49:40Z","title":"Learning More with Less: Self-Supervised Approaches for Low-Resource Speech Emotion Recognition","version":1},"cited_work":{"arxiv_id":"2506.02059","doi":null,"metadata_source":"pith","pith_arxiv_id":"2506.02059","snapshot_observed_at":"2026-08-07T11:56:06.781642Z","title":"Learning More with Less: Self-Supervised Approaches for Low-Resource Speech Emotion Recognition","venue":"cs.SD","work_id":"c7436f17-5b16-4d7d-8f0c-6ba19754950b","year":2025},"citing_paper":{"arxiv_id":"2506.02059","last_updated":"2025-06-01T15:49:40Z","snapshot_observed_at":"2026-08-09T16:12:06.482558Z","submitted_at":"2025-06-01T15:49:40Z","title":"Learning More with Less: Self-Supervised Approaches for Low-Resource Speech Emotion Recognition","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-07T11:56:02.131837Z"},"links":{"cited_paper":"/paper/2506.02059","citing_paper":"/paper/2506.02059"},"observation_digest":"sha256:4fd744b48fbd0221698c21107fd768f1ce36d217069c6ecb261f4ef9fdada9f8","observation_id":"711c5d98-9dcb-4080-bbf4-e4df9a710278","resolution":{"observed_at":"2026-08-07T11:56:06.958185Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}}],"links":{"evidence":"/evidence","html":"/paper/2506.02059/citation-record","integrity":"/paper/2506.02059/integrity","json":"/paper/2506.02059/citation-record.json","paper":"/paper/2506.02059"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:56:09.595119Z","title":"The goal of SER is to automatically infer emotional states from speech signals, enabling more natural and adaptive interactions between humans and machines","venue":null,"work_id":"2d9f8c15-79f5-4d1f-a297-6b02000044fa","year":null},"citing_paper":{"arxiv_id":"2506.02059","last_updated":"2025-06-01T15:49:40Z","snapshot_observed_at":"2026-08-09T16:12:06.482558Z","submitted_at":"2025-06-01T15:49:40Z","title":"Learning More with Less: Self-Supervised Approaches for Low-Resource Speech Emotion Recognition","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-07T11:56:02.096052Z"},"links":{"citing_paper":"/paper/2506.02059"},"observation_digest":"sha256:7c0557d058ee9f2035da29885975d03639e717e4b0788f0f38eec2e3dfed7203","observation_id":"a6b44e2d-3790-4f5d-a236-43331f2023b9","resolution":{"observed_at":"2026-08-07T11:56:09.599644Z","resolver_source":"raw_fallback","status":"malformed_identifier"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2506.02059","last_updated":"2025-06-01T15:49:40Z","snapshot_observed_at":"2026-08-09T16:12:06.482558Z","submitted_at":"2025-06-01T15:49:40Z","title":"Learning More with Less: Self-Supervised Approaches for Low-Resource Speech Emotion Recognition","version":1},"cited_work":{"arxiv_id":"2506.02059","doi":null,"metadata_source":"pith","pith_arxiv_id":"2506.02059","snapshot_observed_at":"2026-08-07T11:56:06.781642Z","title":"Learning More with Less: Self-Supervised Approaches for Low-Resource Speech Emotion Recognition","venue":"cs.SD","work_id":"c7436f17-5b16-4d7d-8f0c-6ba19754950b","year":2025},"citing_paper":{"arxiv_id":"2506.02059","last_updated":"2025-06-01T15:49:40Z","snapshot_observed_at":"2026-08-09T16:12:06.482558Z","submitted_at":"2025-06-01T15:49:40Z","title":"Learning More with Less: Self-Supervised Approaches for Low-Resource Speech Emotion Recognition","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-07T11:56:02.131837Z"},"links":{"cited_paper":"/paper/2506.02059","citing_paper":"/paper/2506.02059"},"observation_digest":"sha256:4fd744b48fbd0221698c21107fd768f1ce36d217069c6ecb261f4ef9fdada9f8","observation_id":"711c5d98-9dcb-4080-bbf4-e4df9a710278","resolution":{"observed_at":"2026-08-07T11:56:06.958185Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:56:09.579036Z","title":"happy,” “sad,","venue":null,"work_id":"ecbc4b5b-004e-4a78-bbe3-40ae7cd1f3cf","year":null},"citing_paper":{"arxiv_id":"2506.02059","last_updated":"2025-06-01T15:49:40Z","snapshot_observed_at":"2026-08-09T16:12:06.482558Z","submitted_at":"2025-06-01T15:49:40Z","title":"Learning More with Less: Self-Supervised Approaches for Low-Resource Speech Emotion Recognition","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-07T11:56:02.184517Z"},"links":{"citing_paper":"/paper/2506.02059"},"observation_digest":"sha256:dbafc028fef75ce7885494924d20b2424beddb03ce088f7d71095f8aff1b1397","observation_id":"ad9ed6f4-bb30-4591-8791-26e8495ed198","resolution":{"observed_at":"2026-08-07T11:56:09.584807Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:56:09.546940Z","title":"anger”/“happiness","venue":null,"work_id":"89ae351d-9073-44a0-b8af-3bf8741a6b96","year":null},"citing_paper":{"arxiv_id":"2506.02059","last_updated":"2025-06-01T15:49:40Z","snapshot_observed_at":"2026-08-09T16:12:06.482558Z","submitted_at":"2025-06-01T15:49:40Z","title":"Learning More with Less: Self-Supervised Approaches for Low-Resource Speech Emotion Recognition","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-07T11:56:02.243155Z"},"links":{"citing_paper":"/paper/2506.02059"},"observation_digest":"sha256:f8ec758bc3b778e8c844a14391d606c1a3d2da30b3805933974e946475d5eb02","observation_id":"ee00961f-e033-4b37-a7da-fa037edd58b3","resolution":{"observed_at":"2026-08-07T11:56:09.551533Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:56:09.562049Z","title":"We use Whisper.small.en via transformers 4.39.3","venue":null,"work_id":"d0d56b4f-ca0f-4756-96c5-43c060d2db90","year":null},"citing_paper":{"arxiv_id":"2506.02059","last_updated":"2025-06-01T15:49:40Z","snapshot_observed_at":"2026-08-09T16:12:06.482558Z","submitted_at":"2025-06-01T15:49:40Z","title":"Learning More with Less: Self-Supervised Approaches for Low-Resource Speech Emotion Recognition","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-07T11:56:02.218277Z"},"links":{"citing_paper":"/paper/2506.02059"},"observation_digest":"sha256:dd6da199777234b0b6cb97cea67f705753fd9cf046a62b865d5bb330629330a2","observation_id":"626ce7cd-b21a-43ca-8be9-1922189d656c","resolution":{"observed_at":"2026-08-07T11:56:09.567721Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:56:09.530773Z","title":null,"venue":null,"work_id":"83d4746e-2015-4102-bd4a-97331c008372","year":null},"citing_paper":{"arxiv_id":"2506.02059","last_updated":"2025-06-01T15:49:40Z","snapshot_observed_at":"2026-08-09T16:12:06.482558Z","submitted_at":"2025-06-01T15:49:40Z","title":"Learning More with Less: Self-Supervised Approaches for Low-Resource Speech Emotion Recognition","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-07T11:56:02.280737Z"},"links":{"citing_paper":"/paper/2506.02059"},"observation_digest":"sha256:aca148eae4ee1e098103efae186a7a6580afb026433907a50de3f769b54347c0","observation_id":"c386c8f2-1a78-47fa-987f-cb78678354de","resolution":{"observed_at":"2026-08-07T11:56:09.535935Z","resolver_source":"raw_fallback","status":"malformed_identifier"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:56:09.513614Z","title":"The views, opin- ions and/or findings expressed are those of the authors solely","venue":null,"work_id":"0e10a90e-31e1-4c56-8af1-e11d76229a90","year":2025},"citing_paper":{"arxiv_id":"2506.02059","last_updated":"2025-06-01T15:49:40Z","snapshot_observed_at":"2026-08-09T16:12:06.482558Z","submitted_at":"2025-06-01T15:49:40Z","title":"Learning More with Less: Self-Supervised Approaches for Low-Resource Speech Emotion Recognition","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-07T11:56:02.318600Z"},"links":{"citing_paper":"/paper/2506.02059"},"observation_digest":"sha256:ac2742040728dc32824b4ecdb3f97d03bdd46cf2bd98fce73e3ae5084a0b298f","observation_id":"04005c1e-abf8-4dbf-a574-8a23d00ef00f","resolution":{"observed_at":"2026-08-07T11:56:09.518324Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:56:09.498569Z","title":"Modular neural-svm scheme for speech emotion recognition using anova feature selec- tion method,","venue":null,"work_id":"1a5be110-d98d-40e5-81cf-0759e58bfa3a","year":2013},"citing_paper":{"arxiv_id":"2506.02059","last_updated":"2025-06-01T15:49:40Z","snapshot_observed_at":"2026-08-09T16:12:06.482558Z","submitted_at":"2025-06-01T15:49:40Z","title":"Learning More with Less: Self-Supervised Approaches for Low-Resource Speech Emotion Recognition","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-07T11:56:02.407140Z"},"links":{"citing_paper":"/paper/2506.02059"},"observation_digest":"sha256:5bd82033d0b1d09993cad23d6ff212bd47b83a384e905aa981e688d458156757","observation_id":"649c2c82-f91a-4f73-b042-6990a419e43f","resolution":{"observed_at":"2026-08-07T11:56:09.503664Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:56:09.481479Z","title":"Amplitude modulation features for emotion recognition from speech","venue":null,"work_id":"5c04b09e-bf85-41e0-959e-e01a17815f38","year":2013},"citing_paper":{"arxiv_id":"2506.02059","last_updated":"2025-06-01T15:49:40Z","snapshot_observed_at":"2026-08-09T16:12:06.482558Z","submitted_at":"2025-06-01T15:49:40Z","title":"Learning More with Less: Self-Supervised Approaches for Low-Resource Speech Emotion Recognition","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-07T11:56:02.458442Z"},"links":{"citing_paper":"/paper/2506.02059"},"observation_digest":"sha256:ea029b29ef2e24b978925244cac1f058928af286e947826f3407a18d9bf1f562","observation_id":"f0e14408-ebb8-4cc9-b335-9a5f3ed075d7","resolution":{"observed_at":"2026-08-07T11:56:09.486276Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:56:09.463894Z","title":"Enhanced multiclass svm with threshold- ing fusion for speech-based emotion classification,","venue":null,"work_id":"2067e5cf-8d4c-466d-a365-53076be10bed","year":2017},"citing_paper":{"arxiv_id":"2506.02059","last_updated":"2025-06-01T15:49:40Z","snapshot_observed_at":"2026-08-09T16:12:06.482558Z","submitted_at":"2025-06-01T15:49:40Z","title":"Learning More with Less: Self-Supervised Approaches for Low-Resource Speech Emotion Recognition","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-07T11:56:02.506456Z"},"links":{"citing_paper":"/paper/2506.02059"},"observation_digest":"sha256:d2f5bf4c443d40c87ff5991a2c128f8d15053feb79ceedebe21517aec30ee892","observation_id":"bd947d92-b5ad-4280-a6da-a3b53e3e4b6e","resolution":{"observed_at":"2026-08-07T11:56:09.469625Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:56:09.444560Z","title":"Selection of features for emotion recognition from speech,","venue":null,"work_id":"fe09c16c-b74f-4e9d-b00e-4bf3a9078f02","year":2016},"citing_paper":{"arxiv_id":"2506.02059","last_updated":"2025-06-01T15:49:40Z","snapshot_observed_at":"2026-08-09T16:12:06.482558Z","submitted_at":"2025-06-01T15:49:40Z","title":"Learning More with Less: Self-Supervised Approaches for Low-Resource Speech Emotion Recognition","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-07T11:56:02.569761Z"},"links":{"citing_paper":"/paper/2506.02059"},"observation_digest":"sha256:fb13299bc9a8d7783325095f59c57f347f6810547a83cbcd9d6fd2143676892e","observation_id":"03cb07dc-1684-44dc-927f-68a6a9a257c9","resolution":{"observed_at":"2026-08-07T11:56:09.449555Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:56:09.428228Z","title":"Hidden markov model- based speech emotion recognition,","venue":null,"work_id":"34c63850-353b-4a64-a0f9-16345f1cc29b","year":2003},"citing_paper":{"arxiv_id":"2506.02059","last_updated":"2025-06-01T15:49:40Z","snapshot_observed_at":"2026-08-09T16:12:06.482558Z","submitted_at":"2025-06-01T15:49:40Z","title":"Learning More with Less: Self-Supervised Approaches for Low-Resource Speech Emotion Recognition","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-07T11:56:02.655419Z"},"links":{"citing_paper":"/paper/2506.02059"},"observation_digest":"sha256:4d63d87e03cb79be401265292e744097bc47a10d5a438d18192b80ddc19064b0","observation_id":"b11728a4-f371-4dd6-9dde-80623f5e6da3","resolution":{"observed_at":"2026-08-07T11:56:09.433918Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:56:09.354158Z","title":"A modified feature selec- tion method based on metaheuristic algorithms for speech emo- tion recognition,","venue":null,"work_id":"7e98a825-8b0f-485c-ac75-30699998d996","year":2021},"citing_paper":{"arxiv_id":"2506.02059","last_updated":"2025-06-01T15:49:40Z","snapshot_observed_at":"2026-08-09T16:12:06.482558Z","submitted_at":"2025-06-01T15:49:40Z","title":"Learning More with Less: Self-Supervised Approaches for Low-Resource Speech Emotion Recognition","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-07T11:56:02.710431Z"},"links":{"citing_paper":"/paper/2506.02059"},"observation_digest":"sha256:6b4edd4ac38bfbe1359e5634fba4d7912a5007f460ac099ba5351f92807ca715","observation_id":"6e25c054-1b41-4bfd-bdf4-c76a7672c303","resolution":{"observed_at":"2026-08-07T11:56:09.393905Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:56:09.262341Z","title":"Speech emotion recognition based on formant characteristics feature ex- traction and phoneme type convergence,","venue":null,"work_id":"725a91b3-eba4-4927-9cfa-d59f62f085b3","year":2021},"citing_paper":{"arxiv_id":"2506.02059","last_updated":"2025-06-01T15:49:40Z","snapshot_observed_at":"2026-08-09T16:12:06.482558Z","submitted_at":"2025-06-01T15:49:40Z","title":"Learning More with Less: Self-Supervised Approaches for Low-Resource Speech Emotion Recognition","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-07T11:56:02.773271Z"},"links":{"citing_paper":"/paper/2506.02059"},"observation_digest":"sha256:d530ba5d6eded12c99ee8ab891d0f605d856237e084b1136fa73da5419867847","observation_id":"2902a2df-9dbe-471e-9b8e-c79251ecb4d6","resolution":{"observed_at":"2026-08-07T11:56:09.302221Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:56:09.202422Z","title":"Efficient speech emo- tion recognition using modified feature extraction,","venue":null,"work_id":"07cc1f2c-67de-464d-a723-8d697db6b026","year":2020},"citing_paper":{"arxiv_id":"2506.02059","last_updated":"2025-06-01T15:49:40Z","snapshot_observed_at":"2026-08-09T16:12:06.482558Z","submitted_at":"2025-06-01T15:49:40Z","title":"Learning More with Less: Self-Supervised Approaches for Low-Resource Speech Emotion Recognition","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-07T11:56:02.827006Z"},"links":{"citing_paper":"/paper/2506.02059"},"observation_digest":"sha256:0e5adacc9014e93dbfee322f2772e74ab6e50bac4d5cc8b4232ec6d6c7bd9eaa","observation_id":"d9c28d80-5b08-4d09-911d-072f7d42a07e","resolution":{"observed_at":"2026-08-07T11:56:09.229804Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2002.07590","last_updated":"2020-02-03T09:56:56Z","snapshot_observed_at":"2026-08-08T09:59:06.189761Z","submitted_at":"2020-02-03T09:56:56Z","title":"Speech Emotion Recognition using Support Vector Machine","version":1},"cited_work":{"arxiv_id":"2002.07590","doi":null,"metadata_source":"pith","pith_arxiv_id":"2002.07590","snapshot_observed_at":"2026-08-07T11:56:06.437663Z","title":"Speech Emotion Recognition using Support Vector Machine","venue":"eess.AS","work_id":"08e89960-b88b-43fa-a7b5-bad508063feb","year":2020},"citing_paper":{"arxiv_id":"2506.02059","last_updated":"2025-06-01T15:49:40Z","snapshot_observed_at":"2026-08-09T16:12:06.482558Z","submitted_at":"2025-06-01T15:49:40Z","title":"Learning More with Less: Self-Supervised Approaches for Low-Resource Speech Emotion Recognition","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-07T11:56:02.875636Z"},"links":{"cited_paper":"/paper/2002.07590","citing_paper":"/paper/2506.02059"},"observation_digest":"sha256:5afdf6f0b64e389185aea145a116e9471759521b32bdff5c1127f85182f3bcad","observation_id":"1cd9105a-8319-4945-bf94-2cb8d67a8eef","resolution":{"observed_at":"2026-08-07T11:56:06.605533Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2409.10985","last_updated":"2025-01-07T14:49:48Z","snapshot_observed_at":"2026-08-05T05:06:13.650613Z","submitted_at":"2024-09-17T08:36:45Z","title":"Improving Speech Emotion Recognition in Under-Resourced Languages via Speech-to-Speech Translation with Bootstrapping Data Selection","version":2},"cited_work":{"arxiv_id":"2409.10985","doi":null,"metadata_source":"pith","pith_arxiv_id":"2409.10985","snapshot_observed_at":"2026-08-07T11:56:06.129812Z","title":"Improving Speech Emotion Recognition in Under-Resourced Languages via Speech-to-Speech Translation with Bootstrapping Data Selection","venue":"eess.AS","work_id":"87dd3d30-0589-44b3-9ea3-939844364240","year":2024},"citing_paper":{"arxiv_id":"2506.02059","last_updated":"2025-06-01T15:49:40Z","snapshot_observed_at":"2026-08-09T16:12:06.482558Z","submitted_at":"2025-06-01T15:49:40Z","title":"Learning More with Less: Self-Supervised Approaches for Low-Resource Speech Emotion Recognition","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-07T11:56:02.926732Z"},"links":{"cited_paper":"/paper/2409.10985","citing_paper":"/paper/2506.02059"},"observation_digest":"sha256:50c9f2297cca13696060e107d4c498e1ce33a385d7d281b2780755a4696ac491","observation_id":"7b1f82c0-80ec-418c-9e65-b2716007962d","resolution":{"observed_at":"2026-08-07T11:56:06.238255Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:56:09.184002Z","title":"Multimodal multi-loss fusion network for sentiment analysis,","venue":null,"work_id":"e5bd70a3-081d-4e61-b051-7df3858f8a02","year":2024},"citing_paper":{"arxiv_id":"2506.02059","last_updated":"2025-06-01T15:49:40Z","snapshot_observed_at":"2026-08-09T16:12:06.482558Z","submitted_at":"2025-06-01T15:49:40Z","title":"Learning More with Less: Self-Supervised Approaches for Low-Resource Speech Emotion Recognition","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-07T11:56:02.982031Z"},"links":{"citing_paper":"/paper/2506.02059"},"observation_digest":"sha256:f3510ca61dce6a1583890e2380795c59affa90554c6e1bb02bb8146a1ee6b4ef","observation_id":"28641fe7-e446-4c89-8acc-8c95b4ce87e1","resolution":{"observed_at":"2026-08-07T11:56:09.190171Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2008.03359","last_updated":"2020-08-07T20:06:33Z","snapshot_observed_at":"2026-08-08T19:43:41.811471Z","submitted_at":"2020-08-07T20:06:33Z","title":"A New Approach to Accent Recognition and Conversion for Mandarin Chinese","version":1},"cited_work":{"arxiv_id":"2008.03359","doi":null,"metadata_source":"pith","pith_arxiv_id":"2008.03359","snapshot_observed_at":"2026-08-07T11:56:05.877378Z","title":"A New Approach to Accent Recognition and Conversion for Mandarin Chinese","venue":"eess.AS","work_id":"f0ecffba-8254-4981-a439-b10a910d33c8","year":2020},"citing_paper":{"arxiv_id":"2506.02059","last_updated":"2025-06-01T15:49:40Z","snapshot_observed_at":"2026-08-09T16:12:06.482558Z","submitted_at":"2025-06-01T15:49:40Z","title":"Learning More with Less: Self-Supervised Approaches for Low-Resource Speech Emotion Recognition","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-07T11:56:03.034207Z"},"links":{"cited_paper":"/paper/2008.03359","citing_paper":"/paper/2506.02059"},"observation_digest":"sha256:2551bd1771597bee06e852a5cc82894dc3c5d4ad6d9b5c542ccf58edcdd6c838","observation_id":"3f7a2d10-ec43-47df-885c-42ffd4d74567","resolution":{"observed_at":"2026-08-07T11:56:05.970124Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2407.21315","last_updated":"2024-12-23T12:35:12Z","snapshot_observed_at":"2026-07-31T18:13:32.261738Z","submitted_at":"2024-07-31T03:53:14Z","title":"Beyond Silent Letters: Amplifying LLMs in Emotion Recognition with Vocal Nuances","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2407.21315","snapshot_observed_at":"2026-08-07T11:56:03.104110Z","title":"Beyond silent letters: Amplifying llms in emotion recognition with vocal nuances,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.02059","last_updated":"2025-06-01T15:49:40Z","snapshot_observed_at":"2026-08-09T16:12:06.482558Z","submitted_at":"2025-06-01T15:49:40Z","title":"Learning More with Less: Self-Supervised Approaches for Low-Resource Speech Emotion Recognition","version":1},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-07T11:56:03.104110Z"},"links":{"cited_paper":"/paper/2407.21315","citing_paper":"/paper/2506.02059"},"observation_digest":"sha256:66e507059431aa6d87f5e485e08c62dbd3bbf1a11815bc2beaab7baff19de06e","observation_id":"c9733aa8-c2ab-487d-aa7b-5e710fd048e5","resolution":{"observed_at":"2026-08-07T11:56:03.104110Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:56:09.165270Z","title":"Context-independent multilingual emo- tion recognition from speech signals,","venue":null,"work_id":"5a64fd0d-f471-4618-8d16-303de2f1aa2b","year":2003},"citing_paper":{"arxiv_id":"2506.02059","last_updated":"2025-06-01T15:49:40Z","snapshot_observed_at":"2026-08-09T16:12:06.482558Z","submitted_at":"2025-06-01T15:49:40Z","title":"Learning More with Less: Self-Supervised Approaches for Low-Resource Speech Emotion Recognition","version":1},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-07T11:56:03.167518Z"},"links":{"citing_paper":"/paper/2506.02059"},"observation_digest":"sha256:5778210f279c0d63d5f05621992383a999fe63ae6f154519e26da5c68c0e836c","observation_id":"32b377b3-ac82-422a-babb-9e21147438ef","resolution":{"observed_at":"2026-08-07T11:56:09.171131Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:56:09.143596Z","title":"On acoustic emotion recognition: compensating for covariate shift,","venue":null,"work_id":"f6672870-072d-4df1-8af0-92ca0035614d","year":2013},"citing_paper":{"arxiv_id":"2506.02059","last_updated":"2025-06-01T15:49:40Z","snapshot_observed_at":"2026-08-09T16:12:06.482558Z","submitted_at":"2025-06-01T15:49:40Z","title":"Learning More with Less: Self-Supervised Approaches for Low-Resource Speech Emotion Recognition","version":1},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-07T11:56:03.246325Z"},"links":{"citing_paper":"/paper/2506.02059"},"observation_digest":"sha256:1e45e3c78dea654f67479e8093a5c15ae2fdcb950efbb2d5ccb0f81e00b8f41e","observation_id":"56eb58da-2293-4c62-bf36-f0154f73a795","resolution":{"observed_at":"2026-08-07T11:56:09.150490Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:56:09.123191Z","title":"Cross-corpus speech emotion recognition based on transfer non- negative matrix factorization,","venue":null,"work_id":"4d5fcc57-4bf2-4681-bec0-3a9f60df9ea7","year":2016},"citing_paper":{"arxiv_id":"2506.02059","last_updated":"2025-06-01T15:49:40Z","snapshot_observed_at":"2026-08-09T16:12:06.482558Z","submitted_at":"2025-06-01T15:49:40Z","title":"Learning More with Less: Self-Supervised Approaches for Low-Resource Speech Emotion Recognition","version":1},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-07T11:56:03.299686Z"},"links":{"citing_paper":"/paper/2506.02059"},"observation_digest":"sha256:0cc733af7a109057d5c6300989d6abe60ecc44f954a50475d92631c6560b350f","observation_id":"372952eb-a0ba-4421-a8c4-407b24af6562","resolution":{"observed_at":"2026-08-07T11:56:09.129930Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:56:09.102599Z","title":"Deep implicit distribution alignment networks for cross-corpus speech emotion recognition,","venue":null,"work_id":"ff060e2d-ffc9-420b-9820-b48f19703e1c","year":2023},"citing_paper":{"arxiv_id":"2506.02059","last_updated":"2025-06-01T15:49:40Z","snapshot_observed_at":"2026-08-09T16:12:06.482558Z","submitted_at":"2025-06-01T15:49:40Z","title":"Learning More with Less: Self-Supervised Approaches for Low-Resource Speech Emotion Recognition","version":1},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-07T11:56:03.363184Z"},"links":{"citing_paper":"/paper/2506.02059"},"observation_digest":"sha256:d12bdce9a98120c15559a291d20ddad14f2eee13c7063b44a1acac255b81bdeb","observation_id":"d1ef6795-d78a-41a0-99f6-1e983550b7ab","resolution":{"observed_at":"2026-08-07T11:56:09.109755Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2505.20511","last_updated":"2025-09-09T06:34:44Z","snapshot_observed_at":"2026-08-09T02:01:08.440026Z","submitted_at":"2025-05-26T20:23:24Z","title":"Multimodal Emotion Recognition in Conversations: A Survey of Methods, Trends, Challenges and Prospects","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2505.20511","snapshot_observed_at":"2026-08-07T11:56:03.435550Z","title":"Multimodal emotion recognition in conversations: A survey of methods, trends, challenges and prospects,","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2506.02059","last_updated":"2025-06-01T15:49:40Z","snapshot_observed_at":"2026-08-09T16:12:06.482558Z","submitted_at":"2025-06-01T15:49:40Z","title":"Learning More with Less: Self-Supervised Approaches for Low-Resource Speech Emotion Recognition","version":1},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-08-07T11:56:03.435550Z"},"links":{"cited_paper":"/paper/2505.20511","citing_paper":"/paper/2506.02059"},"observation_digest":"sha256:b0580fe3adac892e9fdc9ca1fdd63a8cedc1af7ac2032965c9f1444b3d84ee13","observation_id":"3baf0bf4-0123-43a8-9954-62ceef008c27","resolution":{"observed_at":"2026-08-07T11:56:03.435550Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:56:09.085127Z","title":"Contrastive unsupervised learning for speech emotion recognition,","venue":null,"work_id":"26744c77-baf2-43d4-afb9-f96552afb68c","year":2021},"citing_paper":{"arxiv_id":"2506.02059","last_updated":"2025-06-01T15:49:40Z","snapshot_observed_at":"2026-08-09T16:12:06.482558Z","submitted_at":"2025-06-01T15:49:40Z","title":"Learning More with Less: Self-Supervised Approaches for Low-Resource Speech Emotion Recognition","version":1},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-08-07T11:56:03.506157Z"},"links":{"citing_paper":"/paper/2506.02059"},"observation_digest":"sha256:c51dbed036ca976b3903c1ac066947b72a16c9b601b034bec0ed0c6eef4601ee","observation_id":"da608ef9-71fe-4509-b7b2-01279465fc0b","resolution":{"observed_at":"2026-08-07T11:56:09.090419Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:56:09.067689Z","title":"Scser: Supervised contrastive learning for speech emotion recognition using transformers,","venue":null,"work_id":"72803b93-19f3-443e-95ec-e4bf9a2e66b6","year":2022},"citing_paper":{"arxiv_id":"2506.02059","last_updated":"2025-06-01T15:49:40Z","snapshot_observed_at":"2026-08-09T16:12:06.482558Z","submitted_at":"2025-06-01T15:49:40Z","title":"Learning More with Less: Self-Supervised Approaches for Low-Resource Speech Emotion Recognition","version":1},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-08-07T11:56:03.596537Z"},"links":{"citing_paper":"/paper/2506.02059"},"observation_digest":"sha256:753a930aed0e3b5c0f0cbfc42db7de9ee22b5fac1739723af5924c66458dac3f","observation_id":"081c4b8d-4a2c-40fd-835c-b6a79ebce29d","resolution":{"observed_at":"2026-08-07T11:56:09.073103Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:56:09.046118Z","title":"Bootstrap your own latent-a new approach to self-supervised learning,","venue":null,"work_id":"f410f499-20b6-4ef2-bdc3-389aaf07fe00","year":2020},"citing_paper":{"arxiv_id":"2506.02059","last_updated":"2025-06-01T15:49:40Z","snapshot_observed_at":"2026-08-09T16:12:06.482558Z","submitted_at":"2025-06-01T15:49:40Z","title":"Learning More with Less: Self-Supervised Approaches for Low-Resource Speech Emotion Recognition","version":1},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-08-07T11:56:03.693730Z"},"links":{"citing_paper":"/paper/2506.02059"},"observation_digest":"sha256:43f6f2ef113c82a67db36efd12b9d81ef653fad67842c329a878bc4b16f75c26","observation_id":"4252db27-0d03-4e1d-b00f-28eee7e62f32","resolution":{"observed_at":"2026-08-07T11:56:09.053503Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:56:09.025987Z","title":"Byol for audio: Self-supervised learning for general-purpose au- dio representation,","venue":null,"work_id":"d60fbf59-f5f5-4242-aae1-e37a6446e6df","year":2021},"citing_paper":{"arxiv_id":"2506.02059","last_updated":"2025-06-01T15:49:40Z","snapshot_observed_at":"2026-08-09T16:12:06.482558Z","submitted_at":"2025-06-01T15:49:40Z","title":"Learning More with Less: Self-Supervised Approaches for Low-Resource Speech Emotion Recognition","version":1},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-08-07T11:56:03.756089Z"},"links":{"citing_paper":"/paper/2506.02059"},"observation_digest":"sha256:62078626224a90ba175d5ea8afb44db5e239bf8564d000d9fcc369c7333ca5c2","observation_id":"42f6409a-0536-49cb-8eb8-f8ea737c7294","resolution":{"observed_at":"2026-08-07T11:56:09.031408Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:56:03.844069Z","title":"wav2vec 2.0: A framework for self-supervised learning of speech repre- sentations,","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2506.02059","last_updated":"2025-06-01T15:49:40Z","snapshot_observed_at":"2026-08-09T16:12:06.482558Z","submitted_at":"2025-06-01T15:49:40Z","title":"Learning More with Less: Self-Supervised Approaches for Low-Resource Speech Emotion Recognition","version":1},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-08-07T11:56:03.844069Z"},"links":{"citing_paper":"/paper/2506.02059"},"observation_digest":"sha256:88ca70ccb7c720c6eb1a00c775bfc4d9b0250f2b63ed48c3051880bf36d4e06a","observation_id":"25e394cc-5c87-4b85-aec9-00af40a4988a","resolution":{"observed_at":"2026-08-07T11:56:03.844069Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:56:08.998721Z","title":"SpecAugment: A simple data augmen- tation method for automatic speech recognition,","venue":null,"work_id":"dc8d345f-9c47-4301-9676-25c5a04894c9","year":2019},"citing_paper":{"arxiv_id":"2506.02059","last_updated":"2025-06-01T15:49:40Z","snapshot_observed_at":"2026-08-09T16:12:06.482558Z","submitted_at":"2025-06-01T15:49:40Z","title":"Learning More with Less: Self-Supervised Approaches for Low-Resource Speech Emotion Recognition","version":1},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-08-07T11:56:03.936881Z"},"links":{"citing_paper":"/paper/2506.02059"},"observation_digest":"sha256:113a4e25c9c18d78884b9c357195ed175b8889769dca91753334abe04f0eff9f","observation_id":"49720e77-e5ed-4648-b487-4e1deddc1385","resolution":{"observed_at":"2026-08-07T11:56:09.004048Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:56:08.981516Z","title":"Revealing emo- tional clusters in speaker embeddings: A contrastive learning strategy for speech emotion recognition,","venue":null,"work_id":"d1765499-d7c8-44cd-b267-28e680ba362f","year":2024},"citing_paper":{"arxiv_id":"2506.02059","last_updated":"2025-06-01T15:49:40Z","snapshot_observed_at":"2026-08-09T16:12:06.482558Z","submitted_at":"2025-06-01T15:49:40Z","title":"Learning More with Less: Self-Supervised Approaches for Low-Resource Speech Emotion Recognition","version":1},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-08-07T11:56:04.001232Z"},"links":{"citing_paper":"/paper/2506.02059"},"observation_digest":"sha256:aa9e5b5ed59a64667c85b5c746f209b87e327b8cb6d881ad1bfdec2a74f96b1a","observation_id":"26a850d0-a5df-49d4-859a-9c2c9b8caf77","resolution":{"observed_at":"2026-08-07T11:56:08.986676Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:56:08.964243Z","title":"A comparative study of pre-trained speech and audio embeddings for speech emotion recognition,","venue":null,"work_id":"eb0801ef-377f-427e-9ca5-bc41aa7cb831","year":2023},"citing_paper":{"arxiv_id":"2506.02059","last_updated":"2025-06-01T15:49:40Z","snapshot_observed_at":"2026-08-09T16:12:06.482558Z","submitted_at":"2025-06-01T15:49:40Z","title":"Learning More with Less: Self-Supervised Approaches for Low-Resource Speech Emotion Recognition","version":1},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-08-07T11:56:04.065659Z"},"links":{"citing_paper":"/paper/2506.02059"},"observation_digest":"sha256:7514ee6df1c6a6c1e3d149d1c2fd8e83ac3d6066d872084b721ad214c2c259be","observation_id":"78dbe2b8-532c-4d9e-a8a7-41fa54bc73fe","resolution":{"observed_at":"2026-08-07T11:56:08.969904Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:56:08.945386Z","title":"ECAPA- TDNN: Emphasized channel attention, propagation and aggrega- tion in TDNN based speaker verification,","venue":null,"work_id":"2438df4a-0ce3-453a-bc8f-6bcd9d1b0bfb","year":2020},"citing_paper":{"arxiv_id":"2506.02059","last_updated":"2025-06-01T15:49:40Z","snapshot_observed_at":"2026-08-09T16:12:06.482558Z","submitted_at":"2025-06-01T15:49:40Z","title":"Learning More with Less: Self-Supervised Approaches for Low-Resource Speech Emotion Recognition","version":1},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-08-07T11:56:04.137419Z"},"links":{"citing_paper":"/paper/2506.02059"},"observation_digest":"sha256:83ddecf97d7d6e6fc65f2e9f8c8423da1a82f341931208ac81fd4f0b8bac8aa5","observation_id":"48016ccc-71ee-4e5b-be4c-f4c7d677e932","resolution":{"observed_at":"2026-08-07T11:56:08.951389Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:56:08.878495Z","title":"Improved deep metric learning with multi-class N-pair loss objective,","venue":null,"work_id":"85a6e713-e58a-45ae-a7e2-5c42a9b13b38","year":2016},"citing_paper":{"arxiv_id":"2506.02059","last_updated":"2025-06-01T15:49:40Z","snapshot_observed_at":"2026-08-09T16:12:06.482558Z","submitted_at":"2025-06-01T15:49:40Z","title":"Learning More with Less: Self-Supervised Approaches for Low-Resource Speech Emotion Recognition","version":1},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-08-07T11:56:04.202197Z"},"links":{"citing_paper":"/paper/2506.02059"},"observation_digest":"sha256:b397b07b6758d59e8da9dd2ae715a20dac1637fff733206082cd1a446d6a11d8","observation_id":"dadfe835-2a82-420d-86ff-c66cdcda19de","resolution":{"observed_at":"2026-08-07T11:56:08.918800Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:56:08.762109Z","title":"Building naturalistic emotionally bal- anced speech corpus by retrieving emotional speech from ex- isting podcast recordings,","venue":null,"work_id":"0ac2941d-94e7-46f4-baeb-cd1c7e7a73bd","year":2024},"citing_paper":{"arxiv_id":"2506.02059","last_updated":"2025-06-01T15:49:40Z","snapshot_observed_at":"2026-08-09T16:12:06.482558Z","submitted_at":"2025-06-01T15:49:40Z","title":"Learning More with Less: Self-Supervised Approaches for Low-Resource Speech Emotion Recognition","version":1},"reference_index":36,"source":"pdf_text","source_observed_at":"2026-08-07T11:56:04.226941Z"},"links":{"citing_paper":"/paper/2506.02059"},"observation_digest":"sha256:c0190aed25fb2b80b6ef443ccb762a1f8ce6e6a9aed7b47d4c19a61f33585942","observation_id":"3908389f-27df-4c19-aa4f-7218ec2ccfa2","resolution":{"observed_at":"2026-08-07T11:56:08.780186Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:56:08.675229Z","title":"IEMOCAP: interactive emotional dyadic motion capture database,","venue":null,"work_id":"b81078bd-1baf-428b-a9ae-e9a4cae41cd0","year":2008},"citing_paper":{"arxiv_id":"2506.02059","last_updated":"2025-06-01T15:49:40Z","snapshot_observed_at":"2026-08-09T16:12:06.482558Z","submitted_at":"2025-06-01T15:49:40Z","title":"Learning More with Less: Self-Supervised Approaches for Low-Resource Speech Emotion Recognition","version":1},"reference_index":37,"source":"pdf_text","source_observed_at":"2026-08-07T11:56:04.415054Z"},"links":{"citing_paper":"/paper/2506.02059"},"observation_digest":"sha256:ba596d0e5c624a4e108429cfbad0d7e40e35f4da58cba31066ef959f101a52e4","observation_id":"f1ac2343-f515-459e-bb2c-16d87a6cf20d","resolution":{"observed_at":"2026-08-07T11:56:08.713876Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:56:08.574028Z","title":"A database of german emotional speech,","venue":null,"work_id":"008cf52b-3e4d-464a-9f37-beb3052504f2","year":2005},"citing_paper":{"arxiv_id":"2506.02059","last_updated":"2025-06-01T15:49:40Z","snapshot_observed_at":"2026-08-09T16:12:06.482558Z","submitted_at":"2025-06-01T15:49:40Z","title":"Learning More with Less: Self-Supervised Approaches for Low-Resource Speech Emotion Recognition","version":1},"reference_index":38,"source":"pdf_text","source_observed_at":"2026-08-07T11:56:04.570053Z"},"links":{"citing_paper":"/paper/2506.02059"},"observation_digest":"sha256:be61c1485c288f565136ae5e6ebd805647b2669615fa2d0ef38a388e78ab2273","observation_id":"a01d78e1-bb79-4889-91e5-fa4d7c9e0e65","resolution":{"observed_at":"2026-08-07T11:56:08.624503Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:56:08.475760Z","title":"Cross lingual speech emotion recognition: Urdu vs. western languages,","venue":null,"work_id":"e3fa192e-e982-41c0-9397-58891190e4e0","year":2018},"citing_paper":{"arxiv_id":"2506.02059","last_updated":"2025-06-01T15:49:40Z","snapshot_observed_at":"2026-08-09T16:12:06.482558Z","submitted_at":"2025-06-01T15:49:40Z","title":"Learning More with Less: Self-Supervised Approaches for Low-Resource Speech Emotion Recognition","version":1},"reference_index":39,"source":"pdf_text","source_observed_at":"2026-08-07T11:56:04.732996Z"},"links":{"citing_paper":"/paper/2506.02059"},"observation_digest":"sha256:8745267e6fbcf7516ea22a99212f7b08f3efc02df902ee70054e08ec6f6c0617","observation_id":"5b5c7b7f-c743-4ae6-9063-3d7e50640443","resolution":{"observed_at":"2026-08-07T11:56:08.502177Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:56:08.226026Z","title":"SUST bangla emotional speech corpus (SUBESCO): An audio-only emotional speech corpus for bangla,","venue":null,"work_id":"c2dcdb6e-8099-4cd3-b6c3-fb28d843cfd0","year":2021},"citing_paper":{"arxiv_id":"2506.02059","last_updated":"2025-06-01T15:49:40Z","snapshot_observed_at":"2026-08-09T16:12:06.482558Z","submitted_at":"2025-06-01T15:49:40Z","title":"Learning More with Less: Self-Supervised Approaches for Low-Resource Speech Emotion Recognition","version":1},"reference_index":40,"source":"pdf_text","source_observed_at":"2026-08-07T11:56:04.863032Z"},"links":{"citing_paper":"/paper/2506.02059"},"observation_digest":"sha256:947f37227f5fb2c093780f56c1ec04a24d7ca98988ec0e392ee38e41f082ddfb","observation_id":"65dc2f63-138f-40e0-b291-56e6f48019a4","resolution":{"observed_at":"2026-08-07T11:56:08.329137Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:56:08.005563Z","title":"A mapping on current classifying categories of emotions used in multimodal models for emotion recognition,","venue":null,"work_id":"1e7f5508-1f3f-4186-9fa6-39c2a4dde412","year":2024},"citing_paper":{"arxiv_id":"2506.02059","last_updated":"2025-06-01T15:49:40Z","snapshot_observed_at":"2026-08-09T16:12:06.482558Z","submitted_at":"2025-06-01T15:49:40Z","title":"Learning More with Less: Self-Supervised Approaches for Low-Resource Speech Emotion Recognition","version":1},"reference_index":41,"source":"pdf_text","source_observed_at":"2026-08-07T11:56:05.022216Z"},"links":{"citing_paper":"/paper/2506.02059"},"observation_digest":"sha256:59875d20fe464dcc97d8c76a4e7ece0e2b16621faa1949d0dc7f1e31b5cfb1db","observation_id":"830f635f-6053-414a-8119-da2872996e0c","resolution":{"observed_at":"2026-08-07T11:56:08.110377Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:56:07.735876Z","title":"Common voice: A massively-multilingual speech corpus,","venue":null,"work_id":"26bf4d78-e3e8-4402-b335-18c5accda1f5","year":2019},"citing_paper":{"arxiv_id":"2506.02059","last_updated":"2025-06-01T15:49:40Z","snapshot_observed_at":"2026-08-09T16:12:06.482558Z","submitted_at":"2025-06-01T15:49:40Z","title":"Learning More with Less: Self-Supervised Approaches for Low-Resource Speech Emotion Recognition","version":1},"reference_index":42,"source":"pdf_text","source_observed_at":"2026-08-07T11:56:05.176805Z"},"links":{"citing_paper":"/paper/2506.02059"},"observation_digest":"sha256:72e9e3b2bc6b82e4ae861f80345f5070facc9b3f59691478692643e9c1adaf44","observation_id":"a34ed134-b4f2-4754-b400-6760a12f5838","resolution":{"observed_at":"2026-08-07T11:56:07.838724Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:56:07.516869Z","title":"Robust speech recognition via large-scale weak supervision,","venue":null,"work_id":"6cd49880-b5af-4e95-af12-4a882fdb4119","year":2022},"citing_paper":{"arxiv_id":"2506.02059","last_updated":"2025-06-01T15:49:40Z","snapshot_observed_at":"2026-08-09T16:12:06.482558Z","submitted_at":"2025-06-01T15:49:40Z","title":"Learning More with Less: Self-Supervised Approaches for Low-Resource Speech Emotion Recognition","version":1},"reference_index":43,"source":"pdf_text","source_observed_at":"2026-08-07T11:56:05.310254Z"},"links":{"citing_paper":"/paper/2506.02059"},"observation_digest":"sha256:5f7d9754b1a9e821d63300ef681632cb1ef8edf2ad166e2e4b819737bf644e16","observation_id":"ed0c6136-ee25-41a1-9108-d368845d6830","resolution":{"observed_at":"2026-08-07T11:56:07.618498Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:56:07.276752Z","title":"Towards generalizable SER: Soft labeling and data augmentation for modeling temporal emotion shifts in large-scale multilingual speech,","venue":null,"work_id":"20d9b1e8-ad97-4ca9-beec-8e84732d01db","year":2023},"citing_paper":{"arxiv_id":"2506.02059","last_updated":"2025-06-01T15:49:40Z","snapshot_observed_at":"2026-08-09T16:12:06.482558Z","submitted_at":"2025-06-01T15:49:40Z","title":"Learning More with Less: Self-Supervised Approaches for Low-Resource Speech Emotion Recognition","version":1},"reference_index":44,"source":"pdf_text","source_observed_at":"2026-08-07T11:56:05.493371Z"},"links":{"citing_paper":"/paper/2506.02059"},"observation_digest":"sha256:0dcda48911c63f9d17ccefe212cf8629e47415f6418a5625f11a133ddc7fe456","observation_id":"047d47be-059e-4f90-972c-96dcbe8fd65a","resolution":{"observed_at":"2026-08-07T11:56:07.395728Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T11:56:07.090764Z","title":"Decoupled weight decay regulariza- tion,","venue":null,"work_id":"a39089c5-b701-4bca-ac24-ae69800323be","year":2017},"citing_paper":{"arxiv_id":"2506.02059","last_updated":"2025-06-01T15:49:40Z","snapshot_observed_at":"2026-08-09T16:12:06.482558Z","submitted_at":"2025-06-01T15:49:40Z","title":"Learning More with Less: Self-Supervised Approaches for Low-Resource Speech Emotion Recognition","version":1},"reference_index":45,"source":"pdf_text","source_observed_at":"2026-08-07T11:56:05.607696Z"},"links":{"citing_paper":"/paper/2506.02059"},"observation_digest":"sha256:0af1c0183222ead5d105a70c679f248c1e5715325bb964ab748adf15f66f8925","observation_id":"130be1d4-ebdd-4281-9300-3757a479fd89","resolution":{"observed_at":"2026-08-07T11:56:07.184074Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}}],"paper":{"arxiv_id":"2506.02059","last_updated":"2025-06-01T15:49:40Z","latest_version":1,"primary_category":"cs.SD","snapshot_observed_at":"2026-08-09T16:12:06.482558Z","submitted_at":"2025-06-01T15:49:40Z","title":"Learning More with Less: Self-Supervised Approaches for Low-Resource Speech Emotion Recognition"},"reference_resolution":{"displayed":45,"state_counts":{"malformed_identifier":2,"metadata_mismatch":1,"parse_uncertain":0,"unresolved":3,"verified_exact":3,"verified_fuzzy":36},"total_outbound_references":45},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"thesis":"As of 10 August 2026, this Paper Citation Record lists 45 of 45 outbound references and 1 inbound Pith citation observation for arXiv:2506.02059."}