{"as_of":"2026-08-10T04:51:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:df4c732edd18417c27865e2088e4d8b701da2c0826cf70b82f9563b90021b806","coverage":[{"denominator":81,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":81,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-06T05:03:22.360226Z","state":"measured"},{"denominator":81,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":81,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-09T06:31:02.800959+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2508.02448/citation-record","integrity":"/paper/2508.02448/integrity","json":"/paper/2508.02448/citation-record.json","paper":"/paper/2508.02448"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T05:03:19.377166Z","title":"no agreement","venue":null,"work_id":null,"year":2009},"citing_paper":{"arxiv_id":"2508.02448","last_updated":"2025-08-04T14:09:53Z","snapshot_observed_at":"2026-08-06T05:03:05.531743Z","submitted_at":"2025-08-04T14:09:53Z","title":"Charting 15 years of progress in deep learning for speech emotion recognition: A replication study","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-06T05:03:19.377166Z"},"links":{"citing_paper":"/paper/2508.02448"},"observation_digest":"sha256:2928f47ce4dc5e7d517338315bc8830b54e2dabff114f61eb7b2061403857259","observation_id":"3c86e088-8876-425e-a24b-eb251ca703d4","resolution":{"observed_at":"2026-08-06T05:03:19.377166Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T05:03:37.971868Z","title":"In many cases, OOD UAR is, surprisingly, higher than IID","venue":null,"work_id":"3db9729e-55b7-4c8a-b741-d529163d9f8c","year":null},"citing_paper":{"arxiv_id":"2508.02448","last_updated":"2025-08-04T14:09:53Z","snapshot_observed_at":"2026-08-06T05:03:05.531743Z","submitted_at":"2025-08-04T14:09:53Z","title":"Charting 15 years of progress in deep learning for speech emotion recognition: A replication study","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-06T05:03:19.383352Z"},"links":{"citing_paper":"/paper/2508.02448"},"observation_digest":"sha256:36aea4c0ecb92ae140f88b792c67f38cfb6425ba8265fbbe5e76c0c6367b190b","observation_id":"9de93712-50ae-4032-8861-3078be62e6f2","resolution":{"observed_at":"2026-08-06T05:03:38.038489Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T05:03:37.829560Z","title":"We computed the centred kernel alignment (CKA) [53], a measure of similarity for hidden representations using EmoDB as a probing dataset due to its smaller size","venue":null,"work_id":"54ad4751-e975-489b-ac3c-7339f1aad03b","year":null},"citing_paper":{"arxiv_id":"2508.02448","last_updated":"2025-08-04T14:09:53Z","snapshot_observed_at":"2026-08-06T05:03:05.531743Z","submitted_at":"2025-08-04T14:09:53Z","title":"Charting 15 years of progress in deep learning for speech emotion recognition: A replication study","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-06T05:03:19.387975Z"},"links":{"citing_paper":"/paper/2508.02448"},"observation_digest":"sha256:e9b10ea275fb0bd151c3126faab8c9af26f718eea2a8746fe651c37bea6909e3","observation_id":"06e77628-a5a8-4cef-a7b4-6d0b9ddcc6fb","resolution":{"observed_at":"2026-08-06T05:03:37.886827Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T05:03:37.696363Z","title":null,"venue":null,"work_id":"ad949c22-5e5a-47bb-a3ba-259f68e17afe","year":null},"citing_paper":{"arxiv_id":"2508.02448","last_updated":"2025-08-04T14:09:53Z","snapshot_observed_at":"2026-08-06T05:03:05.531743Z","submitted_at":"2025-08-04T14:09:53Z","title":"Charting 15 years of progress in deep learning for speech emotion recognition: A replication study","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-06T05:03:19.392856Z"},"links":{"citing_paper":"/paper/2508.02448"},"observation_digest":"sha256:a42fc8c82b37df37efe4fd0a418ff1db6717187447b25bc0f7b7edf3f8dd79af","observation_id":"ffcd4b06-0b6b-4af2-a0d5-ad4bacc531c4","resolution":{"observed_at":"2026-08-06T05:03:37.744312Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T05:03:37.553500Z","title":"However, as before, the Spearman’s � between noisy UAR and year of publication (���), MACs ( ���), and � of parameters ( ���) was extremely low","venue":null,"work_id":"44f07982-494b-4d43-9071-9a39a22264b2","year":null},"citing_paper":{"arxiv_id":"2508.02448","last_updated":"2025-08-04T14:09:53Z","snapshot_observed_at":"2026-08-06T05:03:05.531743Z","submitted_at":"2025-08-04T14:09:53Z","title":"Charting 15 years of progress in deep learning for speech emotion recognition: A replication study","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-06T05:03:19.397688Z"},"links":{"citing_paper":"/paper/2508.02448"},"observation_digest":"sha256:410b869cb1aec98a921a93c5f66431be0bbe70e92ee3bc8277a0649cccda7323","observation_id":"6c3837b6-80f5-44ba-9f9d-2a94285ed2ea","resolution":{"observed_at":"2026-08-06T05:03:37.618366Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T05:03:37.410925Z","title":"To do so, we computed the speaker-level performance for each task and used that as the utility to compute the Gini index","venue":null,"work_id":"fae7d69a-69c9-48ee-8401-0ba328c1bd11","year":null},"citing_paper":{"arxiv_id":"2508.02448","last_updated":"2025-08-04T14:09:53Z","snapshot_observed_at":"2026-08-06T05:03:05.531743Z","submitted_at":"2025-08-04T14:09:53Z","title":"Charting 15 years of progress in deep learning for speech emotion recognition: A replication study","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-06T05:03:19.402198Z"},"links":{"citing_paper":"/paper/2508.02448"},"observation_digest":"sha256:9c59044fcba6e4329c76b9860f247bbdeea95c2c8f09903a7bfced6f8a0e2234","observation_id":"63894e64-f3dd-4212-9e7d-ddfa01cf5b16","resolution":{"observed_at":"2026-08-06T05:03:37.464255Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T05:03:37.244514Z","title":"neural scaling laws","venue":null,"work_id":"08538b73-08b8-4222-ac6f-8308ceab387e","year":null},"citing_paper":{"arxiv_id":"2508.02448","last_updated":"2025-08-04T14:09:53Z","snapshot_observed_at":"2026-08-06T05:03:05.531743Z","submitted_at":"2025-08-04T14:09:53Z","title":"Charting 15 years of progress in deep learning for speech emotion recognition: A replication study","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-06T05:03:19.406943Z"},"links":{"citing_paper":"/paper/2508.02448"},"observation_digest":"sha256:393c3f8ed4a4d5858a659bf215ecb60cc586f9bc0aea06f6700ec95b4a3de83e","observation_id":"2f346806-f418-4b9f-9434-be6c5ca93f94","resolution":{"observed_at":"2026-08-06T05:03:37.327739Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T05:03:37.137456Z","title":"Speech emotion recognition: Two decades in a nutshell, benchmarks, and ongoing trends,","venue":null,"work_id":"bbce1a49-2589-498a-9a58-a75f9253c577","year":2018},"citing_paper":{"arxiv_id":"2508.02448","last_updated":"2025-08-04T14:09:53Z","snapshot_observed_at":"2026-08-06T05:03:05.531743Z","submitted_at":"2025-08-04T14:09:53Z","title":"Charting 15 years of progress in deep learning for speech emotion recognition: A replication study","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-06T05:03:19.412501Z"},"links":{"citing_paper":"/paper/2508.02448"},"observation_digest":"sha256:4a3c29b8e99b588ed0b337ad8a4381e351a319483f928a10dd1432ed3cd420a5","observation_id":"aede7709-3708-4475-83c5-8d09e98afae4","resolution":{"observed_at":"2026-08-06T05:03:37.188006Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T05:03:19.417271Z","title":"Speech emotion recognition using deep learning techniques: A review,","venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2508.02448","last_updated":"2025-08-04T14:09:53Z","snapshot_observed_at":"2026-08-06T05:03:05.531743Z","submitted_at":"2025-08-04T14:09:53Z","title":"Charting 15 years of progress in deep learning for speech emotion recognition: A replication study","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-06T05:03:19.417271Z"},"links":{"citing_paper":"/paper/2508.02448"},"observation_digest":"sha256:25b1ace94032e3ea072be0eba585ed5654e70d4f957f72c73eca3a8ebe176fb0","observation_id":"a8d7c008-a5f9-4410-b002-4d057aea44c7","resolution":{"observed_at":"2026-08-06T05:03:19.417271Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":"10.21437/odyssey.2024-35","metadata_source":"doi_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T05:03:22.611409Z","title":"Odyssey 2024 – speech emotion recognition challenge: Dataset, baseline framework, and results,","venue":null,"work_id":"969b7dd7-9238-4583-8a47-e106572f0560","year":2024},"citing_paper":{"arxiv_id":"2508.02448","last_updated":"2025-08-04T14:09:53Z","snapshot_observed_at":"2026-08-06T05:03:05.531743Z","submitted_at":"2025-08-04T14:09:53Z","title":"Charting 15 years of progress in deep learning for speech emotion recognition: A replication study","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-06T05:03:19.422484Z"},"links":{"citing_paper":"/paper/2508.02448"},"observation_digest":"sha256:0c6cbf4b49ff8a7ffcab99ad6c0fe31795e899800d92b8a9d6d586f3f33c9eff","observation_id":"6c8e5dd0-4484-4431-b28f-dc2484369c5b","resolution":{"observed_at":"2026-08-06T05:03:22.737818Z","resolver_source":"doi","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T05:03:36.965732Z","title":"You BEEP Machine – Emotion in Automatic Speech Understanding Systems,","venue":null,"work_id":"e06b192c-67e3-4c24-9f5e-e1ddbd8314e2","year":1998},"citing_paper":{"arxiv_id":"2508.02448","last_updated":"2025-08-04T14:09:53Z","snapshot_observed_at":"2026-08-06T05:03:05.531743Z","submitted_at":"2025-08-04T14:09:53Z","title":"Charting 15 years of progress in deep learning for speech emotion recognition: A replication study","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-06T05:03:19.427084Z"},"links":{"citing_paper":"/paper/2508.02448"},"observation_digest":"sha256:e0bce08897f4bc777276361dcefcdec3b4fff4fadc22f2b3e49748c5cb706d14","observation_id":"e8f0fd03-a615-4a36-b5e3-f06fd89f7a25","resolution":{"observed_at":"2026-08-06T05:03:37.039782Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T05:03:36.793338Z","title":"Emotion recognition in speech using neural networks,","venue":null,"work_id":"effd0099-a158-46a4-83d2-f9ed538b198c","year":2000},"citing_paper":{"arxiv_id":"2508.02448","last_updated":"2025-08-04T14:09:53Z","snapshot_observed_at":"2026-08-06T05:03:05.531743Z","submitted_at":"2025-08-04T14:09:53Z","title":"Charting 15 years of progress in deep learning for speech emotion recognition: A replication study","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-06T05:03:19.432637Z"},"links":{"citing_paper":"/paper/2508.02448"},"observation_digest":"sha256:b028af6563fbbba2de403caabd2e0063594c0e0df54f38ad5a75e974f4c20f3c","observation_id":"465cfdc3-ff28-4240-8513-8d2339404cee","resolution":{"observed_at":"2026-08-06T05:03:36.856424Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T05:03:36.618586Z","title":"Adieu features? end-to-end speech emotion recognition using a deep convolutional recurrent network,","venue":null,"work_id":"eefbdf84-78cf-4e60-9645-a466089196e3","year":2016},"citing_paper":{"arxiv_id":"2508.02448","last_updated":"2025-08-04T14:09:53Z","snapshot_observed_at":"2026-08-06T05:03:05.531743Z","submitted_at":"2025-08-04T14:09:53Z","title":"Charting 15 years of progress in deep learning for speech emotion recognition: A replication study","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-06T05:03:19.437961Z"},"links":{"citing_paper":"/paper/2508.02448"},"observation_digest":"sha256:1e8f32abac718e8ff07da09d64e0f90ed48c6d60607c1fb937e8f47fa47d7739","observation_id":"ac44449e-5c6b-4f04-962e-12767bcac3ae","resolution":{"observed_at":"2026-08-06T05:03:36.700380Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T05:03:36.479247Z","title":"Dawn of the transformer era in speech emotion recognition: Closing the valence gap,","venue":null,"work_id":"1d8f0497-ca8c-45db-94a0-addc7967bcd6","year":2023},"citing_paper":{"arxiv_id":"2508.02448","last_updated":"2025-08-04T14:09:53Z","snapshot_observed_at":"2026-08-06T05:03:05.531743Z","submitted_at":"2025-08-04T14:09:53Z","title":"Charting 15 years of progress in deep learning for speech emotion recognition: A replication study","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-06T05:03:19.442766Z"},"links":{"citing_paper":"/paper/2508.02448"},"observation_digest":"sha256:db707e091fad9608d2ba07587829d9c88010e344120ec76fbe51b716e0f97aa6","observation_id":"d02c247f-63ea-401f-b5cd-96ef617c4cbb","resolution":{"observed_at":"2026-08-06T05:03:36.526978Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T05:03:36.305522Z","title":"Hear: Holistic evaluation of audio representations,","venue":null,"work_id":"2200b601-d9c5-4063-91bb-636852225ba4","year":2022},"citing_paper":{"arxiv_id":"2508.02448","last_updated":"2025-08-04T14:09:53Z","snapshot_observed_at":"2026-08-06T05:03:05.531743Z","submitted_at":"2025-08-04T14:09:53Z","title":"Charting 15 years of progress in deep learning for speech emotion recognition: A replication study","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-06T05:03:19.447639Z"},"links":{"citing_paper":"/paper/2508.02448"},"observation_digest":"sha256:52d0b6eca526c50e4e559ee9e5141a0483ad7321a27ecb15ca78b902f9590d2b","observation_id":"b55ec4c2-03f1-4d7f-b1f4-ff495a1e9d9f","resolution":{"observed_at":"2026-08-06T05:03:36.402739Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T05:03:19.452825Z","title":"SUPERB: Speech Processing Universal PERformance Benchmark,","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2508.02448","last_updated":"2025-08-04T14:09:53Z","snapshot_observed_at":"2026-08-06T05:03:05.531743Z","submitted_at":"2025-08-04T14:09:53Z","title":"Charting 15 years of progress in deep learning for speech emotion recognition: A replication study","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-06T05:03:19.452825Z"},"links":{"citing_paper":"/paper/2508.02448"},"observation_digest":"sha256:fd804bea6497bcc052a12fa73a24148ac2ea33f61ef7f963f4b99236adfb3011","observation_id":"32c11d96-f5b5-4fe3-8766-fc3de223ee04","resolution":{"observed_at":"2026-08-06T05:03:19.452825Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T05:03:36.125088Z","title":"Crema-d: Crowd-sourced emotional multimodal actors dataset,","venue":null,"work_id":"74b6f06a-de02-4fc0-b889-5d4560667812","year":2014},"citing_paper":{"arxiv_id":"2508.02448","last_updated":"2025-08-04T14:09:53Z","snapshot_observed_at":"2026-08-06T05:03:05.531743Z","submitted_at":"2025-08-04T14:09:53Z","title":"Charting 15 years of progress in deep learning for speech emotion recognition: A replication study","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-06T05:03:19.458352Z"},"links":{"citing_paper":"/paper/2508.02448"},"observation_digest":"sha256:807231f8322486fa22421da52a99126a5a713206adaea2a9d5ff6aaafc0bc403","observation_id":"2f1b721e-2847-414d-a15c-b179db631c95","resolution":{"observed_at":"2026-08-06T05:03:36.194559Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T05:03:35.943150Z","title":"Iemocap: Interactive emotional dyadic motion capture database,","venue":null,"work_id":"e6b31da1-e0de-4e37-b8cd-6dd5484649e3","year":2008},"citing_paper":{"arxiv_id":"2508.02448","last_updated":"2025-08-04T14:09:53Z","snapshot_observed_at":"2026-08-06T05:03:05.531743Z","submitted_at":"2025-08-04T14:09:53Z","title":"Charting 15 years of progress in deep learning for speech emotion recognition: A replication study","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-06T05:03:19.463490Z"},"links":{"citing_paper":"/paper/2508.02448"},"observation_digest":"sha256:175144eca2059b3a8bfb480fa4c34c74ccba4879b9f35e400ba9a22b813974e9","observation_id":"535373da-64ac-48b6-b9e1-31621122754f","resolution":{"observed_at":"2026-08-06T05:03:36.030006Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T05:03:35.771484Z","title":"Probing speech emotion recognition transformers for linguistic knowledge,","venue":null,"work_id":"58d03085-e1fb-4aab-811b-8e40538ed984","year":2022},"citing_paper":{"arxiv_id":"2508.02448","last_updated":"2025-08-04T14:09:53Z","snapshot_observed_at":"2026-08-06T05:03:05.531743Z","submitted_at":"2025-08-04T14:09:53Z","title":"Charting 15 years of progress in deep learning for speech emotion recognition: A replication study","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-06T05:03:19.469588Z"},"links":{"citing_paper":"/paper/2508.02448"},"observation_digest":"sha256:177378f5a892facf210ee47321735897da9fc101319e6641fec097ecbda38c58","observation_id":"5571f54d-bf58-4553-adde-98ab3192b8a2","resolution":{"observed_at":"2026-08-06T05:03:35.863708Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T05:03:35.610008Z","title":"Interspeech 2009 emotion challenge revisited: Benchmarking 15 years of progress in speech emotion recognition,","venue":null,"work_id":"7f050323-e595-40dc-97a6-17625c2df3b3","year":2009},"citing_paper":{"arxiv_id":"2508.02448","last_updated":"2025-08-04T14:09:53Z","snapshot_observed_at":"2026-08-06T05:03:05.531743Z","submitted_at":"2025-08-04T14:09:53Z","title":"Charting 15 years of progress in deep learning for speech emotion recognition: A replication study","version":1},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-06T05:03:19.476425Z"},"links":{"citing_paper":"/paper/2508.02448"},"observation_digest":"sha256:d4ee270dd2cf7835f30ba0b9e836ba00b90db45a294e80db8f82b15888209038","observation_id":"2322f7a5-1c59-4614-adfa-1738ca49a58c","resolution":{"observed_at":"2026-08-06T05:03:35.657867Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T05:03:23.713520Z","title":"Building naturalistic emotionally balanced speech corpus by retrieving emotional speech from existing podcast recordings,","venue":null,"work_id":"614e47cd-b944-4fbc-b3f7-b7342dd899bb","year":2019},"citing_paper":{"arxiv_id":"2508.02448","last_updated":"2025-08-04T14:09:53Z","snapshot_observed_at":"2026-08-06T05:03:05.531743Z","submitted_at":"2025-08-04T14:09:53Z","title":"Charting 15 years of progress in deep learning for speech emotion recognition: A replication study","version":1},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-06T05:03:19.481776Z"},"links":{"citing_paper":"/paper/2508.02448"},"observation_digest":"sha256:080bd4db5ffe203710e00e457f3222ed143690a805c97303d09c4d9df8ff334e","observation_id":"9d0c612f-7023-4693-8c0a-7c06d81acb2f","resolution":{"observed_at":"2026-08-06T05:03:23.946796Z","resolver_source":"arxiv_id_nonexistent","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T05:03:35.437133Z","title":"A database of german emotional speech,","venue":null,"work_id":"2458cf79-d1f8-4968-b72a-4084ab8ea694","year":2005},"citing_paper":{"arxiv_id":"2508.02448","last_updated":"2025-08-04T14:09:53Z","snapshot_observed_at":"2026-08-06T05:03:05.531743Z","submitted_at":"2025-08-04T14:09:53Z","title":"Charting 15 years of progress in deep learning for speech emotion recognition: A replication study","version":1},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-06T05:03:19.486305Z"},"links":{"citing_paper":"/paper/2508.02448"},"observation_digest":"sha256:ad9d858e56c8a7a71862fc5c18821bb353be0048f896442f736ddc87719948cd","observation_id":"9e6a1ad0-389e-4836-9a3d-9e21c473b455","resolution":{"observed_at":"2026-08-06T05:03:35.530815Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T05:03:35.280360Z","title":"Releasing a thoroughly annotated and processed spontaneous emotional database: The fau aibo emotion corpus,","venue":null,"work_id":"0543401f-8dbb-4a55-8064-d0b964e19996","year":2008},"citing_paper":{"arxiv_id":"2508.02448","last_updated":"2025-08-04T14:09:53Z","snapshot_observed_at":"2026-08-06T05:03:05.531743Z","submitted_at":"2025-08-04T14:09:53Z","title":"Charting 15 years of progress in deep learning for speech emotion recognition: A replication study","version":1},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-06T05:03:19.490775Z"},"links":{"citing_paper":"/paper/2508.02448"},"observation_digest":"sha256:fe5fb8a3dcea8783849d20a02726d688146c0420af788226d80efd624f9e3f56","observation_id":"3f5515ba-fd52-49ce-8be9-81dc2de75a9d","resolution":{"observed_at":"2026-08-06T05:03:35.339490Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T05:03:35.046911Z","title":"The Interspeech 2009 Emotion Challenge,","venue":null,"work_id":"bace69c3-c4b8-4156-aa57-909c8856ac15","year":2009},"citing_paper":{"arxiv_id":"2508.02448","last_updated":"2025-08-04T14:09:53Z","snapshot_observed_at":"2026-08-06T05:03:05.531743Z","submitted_at":"2025-08-04T14:09:53Z","title":"Charting 15 years of progress in deep learning for speech emotion recognition: A replication study","version":1},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-06T05:03:19.495279Z"},"links":{"citing_paper":"/paper/2508.02448"},"observation_digest":"sha256:0e220ef6bc6ccc8317c89310776caaa734e8b277ca1cfd0cf3f271658dc81b7a","observation_id":"6d422279-cd83-4f7b-9d95-a3848f4ab81c","resolution":{"observed_at":"2026-08-06T05:03:35.171599Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T05:03:34.907790Z","title":"Sewa db: A rich database for audio-visual emotion and sentiment research in the wild,","venue":null,"work_id":"a60bdc23-a592-4ec6-a4bd-77822b0c746e","year":2019},"citing_paper":{"arxiv_id":"2508.02448","last_updated":"2025-08-04T14:09:53Z","snapshot_observed_at":"2026-08-06T05:03:05.531743Z","submitted_at":"2025-08-04T14:09:53Z","title":"Charting 15 years of progress in deep learning for speech emotion recognition: A replication study","version":1},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-08-06T05:03:19.500194Z"},"links":{"citing_paper":"/paper/2508.02448"},"observation_digest":"sha256:76c044b969c502c91a47e6a765b1b68e97d0cb5d547ddf2530196c81b9a97bb2","observation_id":"02ac205f-98dc-4b9c-b82b-142035ad9e2d","resolution":{"observed_at":"2026-08-06T05:03:34.963714Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T05:03:34.713857Z","title":"The ryerson audio-visual database of emotional speech and song (ravdess): A dynamic, multimodal set of facial and vocal expressions in north american english,","venue":null,"work_id":"98bea241-6b92-4994-b3a0-2b6317e53a45","year":2018},"citing_paper":{"arxiv_id":"2508.02448","last_updated":"2025-08-04T14:09:53Z","snapshot_observed_at":"2026-08-06T05:03:05.531743Z","submitted_at":"2025-08-04T14:09:53Z","title":"Charting 15 years of progress in deep learning for speech emotion recognition: A replication study","version":1},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-08-06T05:03:19.505340Z"},"links":{"citing_paper":"/paper/2508.02448"},"observation_digest":"sha256:2166ad730ccdc39523320f4a073a1762e78a650b6d5384f7c8415926bfc31f8c","observation_id":"e28eefe0-6884-4d40-8326-60a215afd330","resolution":{"observed_at":"2026-08-06T05:03:34.789421Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T05:03:34.523461Z","title":"Emotion recognition using a hierarchical binary decision tree approach,","venue":null,"work_id":"a1a60ce6-7a53-452a-9c97-86a5e6950f40","year":2011},"citing_paper":{"arxiv_id":"2508.02448","last_updated":"2025-08-04T14:09:53Z","snapshot_observed_at":"2026-08-06T05:03:05.531743Z","submitted_at":"2025-08-04T14:09:53Z","title":"Charting 15 years of progress in deep learning for speech emotion recognition: A replication study","version":1},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-08-06T05:03:19.511972Z"},"links":{"citing_paper":"/paper/2508.02448"},"observation_digest":"sha256:83e7b2ec1c3f987fdc03c787f416ccab7f93221b8106f2fe8106e62a737d9dac","observation_id":"ee951382-6880-4f91-8f91-d8baeb889ddf","resolution":{"observed_at":"2026-08-06T05:03:34.618726Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T05:03:34.309043Z","title":"The bitter lesson,","venue":null,"work_id":"9ec6192d-c8a3-4397-a5ca-a969d875b411","year":2019},"citing_paper":{"arxiv_id":"2508.02448","last_updated":"2025-08-04T14:09:53Z","snapshot_observed_at":"2026-08-06T05:03:05.531743Z","submitted_at":"2025-08-04T14:09:53Z","title":"Charting 15 years of progress in deep learning for speech emotion recognition: A replication study","version":1},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-08-06T05:03:19.517711Z"},"links":{"citing_paper":"/paper/2508.02448"},"observation_digest":"sha256:3339823fdda3933cd66a5dc9a195820c5d2acb84369a930e17de0b3585472118","observation_id":"1f05f92a-9e99-4c42-9fb5-0d9cdaffb199","resolution":{"observed_at":"2026-08-06T05:03:34.418326Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T05:03:34.109219Z","title":"The Geneva minimalistic acoustic parameter set (GeMAPS) for voice research and affective computing,","venue":null,"work_id":"8825b837-e2d8-4b82-b2ae-326e3a630b6e","year":2015},"citing_paper":{"arxiv_id":"2508.02448","last_updated":"2025-08-04T14:09:53Z","snapshot_observed_at":"2026-08-06T05:03:05.531743Z","submitted_at":"2025-08-04T14:09:53Z","title":"Charting 15 years of progress in deep learning for speech emotion recognition: A replication study","version":1},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-08-06T05:03:19.523490Z"},"links":{"citing_paper":"/paper/2508.02448"},"observation_digest":"sha256:a3e05a49e82dcf9a5921230153bcebe41284f3253a3e1d0d172644a0b0827df0","observation_id":"58a90056-4e8a-46a4-b80e-d0f38f0ba0ce","resolution":{"observed_at":"2026-08-06T05:03:34.170561Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T05:03:33.934130Z","title":"An Image-based Deep Spectrum Feature Representation for the Recognition of Emotional Speech,","venue":null,"work_id":"0b9625dc-492b-4a24-b4d7-96e2dd2bf8b4","year":2017},"citing_paper":{"arxiv_id":"2508.02448","last_updated":"2025-08-04T14:09:53Z","snapshot_observed_at":"2026-08-06T05:03:05.531743Z","submitted_at":"2025-08-04T14:09:53Z","title":"Charting 15 years of progress in deep learning for speech emotion recognition: A replication study","version":1},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-08-06T05:03:19.529768Z"},"links":{"citing_paper":"/paper/2508.02448"},"observation_digest":"sha256:8e8e67989f10d0cade77580a9847d6ef7f337ee9d9555d439d1348a66e3c4da7","observation_id":"9a111804-0ed9-45e7-a496-e46af95ff60e","resolution":{"observed_at":"2026-08-06T05:03:34.038394Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T05:03:33.591068Z","title":"Exploring deep spectrum representations via attention- based recurrent and convolutional neural networks for speech emotion recognition,","venue":null,"work_id":"773f036a-d2d9-4bcd-bdbe-38462b571d68","year":2019},"citing_paper":{"arxiv_id":"2508.02448","last_updated":"2025-08-04T14:09:53Z","snapshot_observed_at":"2026-08-06T05:03:05.531743Z","submitted_at":"2025-08-04T14:09:53Z","title":"Charting 15 years of progress in deep learning for speech emotion recognition: A replication study","version":1},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-08-06T05:03:19.535562Z"},"links":{"citing_paper":"/paper/2508.02448"},"observation_digest":"sha256:db6a995d00e6b230d07e4d170b3e8dbdcf6a70de0f31ae5eb7729fdc6673746c","observation_id":"0ac77706-1550-43e7-8d53-17ae967dc763","resolution":{"observed_at":"2026-08-06T05:03:33.781219Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T05:03:33.358979Z","title":"AST: Audio Spectrogram Transformer,","venue":null,"work_id":"edc6ea5d-ac79-4211-bd33-92d4a1985718","year":2021},"citing_paper":{"arxiv_id":"2508.02448","last_updated":"2025-08-04T14:09:53Z","snapshot_observed_at":"2026-08-06T05:03:05.531743Z","submitted_at":"2025-08-04T14:09:53Z","title":"Charting 15 years of progress in deep learning for speech emotion recognition: A replication study","version":1},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-08-06T05:03:19.540383Z"},"links":{"citing_paper":"/paper/2508.02448"},"observation_digest":"sha256:2b6f41b38a49af66d8e7abcf7e078fdd225030696d266f61c3f4e923cf257c7d","observation_id":"8923ae90-2738-4cd1-9be0-85c57d0e2962","resolution":{"observed_at":"2026-08-06T05:03:33.475809Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T05:03:33.091477Z","title":"Audio set: An ontology and human-labeled dataset for audio events,","venue":null,"work_id":"573ff430-ffc6-450f-9e8b-9118ffe88b44","year":2017},"citing_paper":{"arxiv_id":"2508.02448","last_updated":"2025-08-04T14:09:53Z","snapshot_observed_at":"2026-08-06T05:03:05.531743Z","submitted_at":"2025-08-04T14:09:53Z","title":"Charting 15 years of progress in deep learning for speech emotion recognition: A replication study","version":1},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-08-06T05:03:19.546884Z"},"links":{"citing_paper":"/paper/2508.02448"},"observation_digest":"sha256:ba59f853c6f6b8b76d6cb621290650f8f2a929fcb44e48177fad040129892e11","observation_id":"e931c805-abaf-4292-85a1-266d28534600","resolution":{"observed_at":"2026-08-06T05:03:33.243327Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T05:03:32.750885Z","title":"ECAPA-TDNN: Emphasized channel attention, propagation and aggregation in tdnn based speaker verification,","venue":null,"work_id":"74a4eae2-36b1-496b-9eea-69918c8fff4d","year":2020},"citing_paper":{"arxiv_id":"2508.02448","last_updated":"2025-08-04T14:09:53Z","snapshot_observed_at":"2026-08-06T05:03:05.531743Z","submitted_at":"2025-08-04T14:09:53Z","title":"Charting 15 years of progress in deep learning for speech emotion recognition: A replication study","version":1},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-08-06T05:03:19.552857Z"},"links":{"citing_paper":"/paper/2508.02448"},"observation_digest":"sha256:6535f251d7697fa0479e4e26c3af4a8e959b3676bc0ad82712dec347412f8a81","observation_id":"165fef91-0fca-46aa-a9dd-3c3f455f747d","resolution":{"observed_at":"2026-08-06T05:03:32.894033Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T05:03:32.409935Z","title":"Panns: Large-scale pretrained audio neural networks for audio pattern recognition,","venue":null,"work_id":"126353f5-1ed3-4c30-9d20-81dc7eccc14e","year":2020},"citing_paper":{"arxiv_id":"2508.02448","last_updated":"2025-08-04T14:09:53Z","snapshot_observed_at":"2026-08-06T05:03:05.531743Z","submitted_at":"2025-08-04T14:09:53Z","title":"Charting 15 years of progress in deep learning for speech emotion recognition: A replication study","version":1},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-08-06T05:03:19.559189Z"},"links":{"citing_paper":"/paper/2508.02448"},"observation_digest":"sha256:cabb2d0f4cb9de0b49582ae27fc6c2440defaaa444e60e43e54ea22a27818971","observation_id":"99bf963c-da43-4abb-8b76-9c213c88ef29","resolution":{"observed_at":"2026-08-06T05:03:32.513494Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T05:03:32.037109Z","title":"The role of task and acoustic similarity in audio transfer learning: Insights from the speech emotion recognition case,","venue":null,"work_id":"f54c6a97-e7fa-4700-aa4b-d95dc601a85b","year":2021},"citing_paper":{"arxiv_id":"2508.02448","last_updated":"2025-08-04T14:09:53Z","snapshot_observed_at":"2026-08-06T05:03:05.531743Z","submitted_at":"2025-08-04T14:09:53Z","title":"Charting 15 years of progress in deep learning for speech emotion recognition: A replication study","version":1},"reference_index":36,"source":"pdf_text","source_observed_at":"2026-08-06T05:03:19.565002Z"},"links":{"citing_paper":"/paper/2508.02448"},"observation_digest":"sha256:12a40b6d2ae3699dee525afdfa4601e58cbae8b6a7877169f205b864f30fb194","observation_id":"1b441607-afe4-4027-9015-17fb85dc1e6d","resolution":{"observed_at":"2026-08-06T05:03:32.191822Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T05:03:31.753174Z","title":"Robust speech recognition via large-scale weak supervision,","venue":null,"work_id":"61cd65bc-c669-4472-b715-995938773354","year":2023},"citing_paper":{"arxiv_id":"2508.02448","last_updated":"2025-08-04T14:09:53Z","snapshot_observed_at":"2026-08-06T05:03:05.531743Z","submitted_at":"2025-08-04T14:09:53Z","title":"Charting 15 years of progress in deep learning for speech emotion recognition: A replication study","version":1},"reference_index":37,"source":"pdf_text","source_observed_at":"2026-08-06T05:03:19.570227Z"},"links":{"citing_paper":"/paper/2508.02448"},"observation_digest":"sha256:8af503e8ce240c716c7f9bb7080f4c672df6886eef03c43818bb644b2b461db8","observation_id":"fe352456-1474-40f6-bb40-c7d366a8696c","resolution":{"observed_at":"2026-08-06T05:03:31.847246Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T05:03:31.417358Z","title":"Wav2vec 2.0: A framework for self-supervised learning of speech representations,","venue":null,"work_id":"26cfb54e-bcf3-432f-865a-7ed14e22374d","year":2020},"citing_paper":{"arxiv_id":"2508.02448","last_updated":"2025-08-04T14:09:53Z","snapshot_observed_at":"2026-08-06T05:03:05.531743Z","submitted_at":"2025-08-04T14:09:53Z","title":"Charting 15 years of progress in deep learning for speech emotion recognition: A replication study","version":1},"reference_index":38,"source":"pdf_text","source_observed_at":"2026-08-06T05:03:19.576878Z"},"links":{"citing_paper":"/paper/2508.02448"},"observation_digest":"sha256:2c94e511e82356aa8529caf8e222058472862c645116bdf1ea806049940ea8b5","observation_id":"50189dd4-8096-4312-b5db-33ad23075429","resolution":{"observed_at":"2026-08-06T05:03:31.519036Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T05:03:19.582137Z","title":"Hubert: Self-supervised speech representation learning by masked prediction of hidden units,","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2508.02448","last_updated":"2025-08-04T14:09:53Z","snapshot_observed_at":"2026-08-06T05:03:05.531743Z","submitted_at":"2025-08-04T14:09:53Z","title":"Charting 15 years of progress in deep learning for speech emotion recognition: A replication study","version":1},"reference_index":39,"source":"pdf_text","source_observed_at":"2026-08-06T05:03:19.582137Z"},"links":{"citing_paper":"/paper/2508.02448"},"observation_digest":"sha256:b46638ce0e4e7a87f1ed2a88f12a6ed65a40adf949a7c9cf24d4a5f40a97e203","observation_id":"8d479d57-4a63-4a7f-a74f-e04e7652f9a7","resolution":{"observed_at":"2026-08-06T05:03:19.582137Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T05:03:31.103607Z","title":"“You stupid tin box","venue":null,"work_id":"2892b189-a728-42ee-a00b-10ca10bc2a55","year":2004},"citing_paper":{"arxiv_id":"2508.02448","last_updated":"2025-08-04T14:09:53Z","snapshot_observed_at":"2026-08-06T05:03:05.531743Z","submitted_at":"2025-08-04T14:09:53Z","title":"Charting 15 years of progress in deep learning for speech emotion recognition: A replication study","version":1},"reference_index":40,"source":"pdf_text","source_observed_at":"2026-08-06T05:03:19.587331Z"},"links":{"citing_paper":"/paper/2508.02448"},"observation_digest":"sha256:fef1d754465e65d2225e9665e2bb4ef296f9f381b3ae4ac83d872b0d0a91f906","observation_id":"b19a71b7-1c46-4286-b224-34dc632d1f1b","resolution":{"observed_at":"2026-08-06T05:03:31.287251Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T05:03:30.802445Z","title":"Steidl, Automatic Classification of Emotion-Related User States in Spontaneous Children’s Speech","venue":null,"work_id":"3c7251c2-b1fa-470d-8d38-5fe8a049105a","year":2009},"citing_paper":{"arxiv_id":"2508.02448","last_updated":"2025-08-04T14:09:53Z","snapshot_observed_at":"2026-08-06T05:03:05.531743Z","submitted_at":"2025-08-04T14:09:53Z","title":"Charting 15 years of progress in deep learning for speech emotion recognition: A replication study","version":1},"reference_index":41,"source":"pdf_text","source_observed_at":"2026-08-06T05:03:19.594185Z"},"links":{"citing_paper":"/paper/2508.02448"},"observation_digest":"sha256:773aa02e15421ba8afc728e29085038c0f8bd715c7ec62ad418f722e42a9b2ee","observation_id":"5949d547-d7d5-4eb6-a090-28466f48831d","resolution":{"observed_at":"2026-08-06T05:03:30.947264Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2412.11943","last_updated":"2025-04-10T13:51:44Z","snapshot_observed_at":"2026-08-08T21:29:42.733595Z","submitted_at":"2024-12-16T16:25:58Z","title":"autrainer: A Modular and Extensible Deep Learning Toolkit for Computer Audition Tasks","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2412.11943","snapshot_observed_at":"2026-08-06T05:03:19.599518Z","title":"Autrainer: A modular and extensible deep learning toolkit for computer audition tasks,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2508.02448","last_updated":"2025-08-04T14:09:53Z","snapshot_observed_at":"2026-08-06T05:03:05.531743Z","submitted_at":"2025-08-04T14:09:53Z","title":"Charting 15 years of progress in deep learning for speech emotion recognition: A replication study","version":1},"reference_index":42,"source":"pdf_text","source_observed_at":"2026-08-06T05:03:19.599518Z"},"links":{"cited_paper":"/paper/2412.11943","citing_paper":"/paper/2508.02448"},"observation_digest":"sha256:43aa8864f7da8b20c84da624c84852fe3e7f99c680f1fd4dc66e1b05649d1e70","observation_id":"336e50d2-ea65-4e82-9918-aa43e14e1f2a","resolution":{"observed_at":"2026-08-06T05:03:19.599518Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T05:03:30.469459Z","title":"Bert: Pre-training of deep bidirectional transformers for language understanding,","venue":null,"work_id":"33fe9667-ccde-4022-8a5c-750a5948d6fa","year":2019},"citing_paper":{"arxiv_id":"2508.02448","last_updated":"2025-08-04T14:09:53Z","snapshot_observed_at":"2026-08-06T05:03:05.531743Z","submitted_at":"2025-08-04T14:09:53Z","title":"Charting 15 years of progress in deep learning for speech emotion recognition: A replication study","version":1},"reference_index":43,"source":"pdf_text","source_observed_at":"2026-08-06T05:03:19.605588Z"},"links":{"citing_paper":"/paper/2508.02448"},"observation_digest":"sha256:40adec138a0598295c7e9b5bd845a95056c5ef4f0f5582a62f16d096667518ef","observation_id":"d3b0dda4-77bd-4931-a7e6-7663e1577982","resolution":{"observed_at":"2026-08-06T05:03:30.646043Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1907.11692","last_updated":"2019-07-26T17:48:29Z","snapshot_observed_at":"2026-07-31T22:31:37.910868Z","submitted_at":"2019-07-26T17:48:29Z","title":"RoBERTa: A Robustly Optimized BERT Pretraining Approach","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1907.11692","snapshot_observed_at":"2026-08-06T05:03:19.610885Z","title":"Roberta: A robustly optimized bert pretraining approach,","venue":null,"work_id":null,"year":1907},"citing_paper":{"arxiv_id":"2508.02448","last_updated":"2025-08-04T14:09:53Z","snapshot_observed_at":"2026-08-06T05:03:05.531743Z","submitted_at":"2025-08-04T14:09:53Z","title":"Charting 15 years of progress in deep learning for speech emotion recognition: A replication study","version":1},"reference_index":44,"source":"pdf_text","source_observed_at":"2026-08-06T05:03:19.610885Z"},"links":{"cited_paper":"/paper/1907.11692","citing_paper":"/paper/2508.02448"},"observation_digest":"sha256:01d4b7c25253c884f5b4f0d7f7f4e2b29a37754224d34673a932ee72b5d6e8d0","observation_id":"47d2668d-17b1-4e17-8845-67af78d60956","resolution":{"observed_at":"2026-08-06T05:03:19.610885Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T05:03:30.189549Z","title":"DistilBERT, a distilled version of BERT: smaller, faster, cheaper and lighter,","venue":null,"work_id":"38c8b15f-d9a4-4797-aa7b-568fc9e12290","year":2019},"citing_paper":{"arxiv_id":"2508.02448","last_updated":"2025-08-04T14:09:53Z","snapshot_observed_at":"2026-08-06T05:03:05.531743Z","submitted_at":"2025-08-04T14:09:53Z","title":"Charting 15 years of progress in deep learning for speech emotion recognition: A replication study","version":1},"reference_index":45,"source":"pdf_text","source_observed_at":"2026-08-06T05:03:19.616889Z"},"links":{"citing_paper":"/paper/2508.02448"},"observation_digest":"sha256:9fe0022f747bd7ac74146023230cf52b2c9207b36de35517656fdea351c6f817","observation_id":"660c4b51-eff2-4d5c-ad98-eb33788ae010","resolution":{"observed_at":"2026-08-06T05:03:30.311960Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T05:03:29.970149Z","title":"Electra: Pre- training text encoders as discriminators rather than generators,","venue":null,"work_id":"4a92e5be-8cf4-4367-986c-81ee4e08c79d","year":2020},"citing_paper":{"arxiv_id":"2508.02448","last_updated":"2025-08-04T14:09:53Z","snapshot_observed_at":"2026-08-06T05:03:05.531743Z","submitted_at":"2025-08-04T14:09:53Z","title":"Charting 15 years of progress in deep learning for speech emotion recognition: A replication study","version":1},"reference_index":46,"source":"pdf_text","source_observed_at":"2026-08-06T05:03:19.621416Z"},"links":{"citing_paper":"/paper/2508.02448"},"observation_digest":"sha256:4c0557fda0872fa941f2741390c297ddfa277c6b6807f332069396b55e924b78","observation_id":"c83ecf1b-aafb-4d69-89dd-9c42b2611aa2","resolution":{"observed_at":"2026-08-06T05:03:30.063045Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2307.09288","last_updated":"2023-07-19T17:08:59Z","snapshot_observed_at":"2026-08-07T12:56:43.323460Z","submitted_at":"2023-07-18T14:31:57Z","title":"Llama 2: Open Foundation and Fine-Tuned Chat Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2307.09288","snapshot_observed_at":"2026-08-06T05:03:19.627042Z","title":"Llama 2: Open foundation and fine-tuned chat models,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2508.02448","last_updated":"2025-08-04T14:09:53Z","snapshot_observed_at":"2026-08-06T05:03:05.531743Z","submitted_at":"2025-08-04T14:09:53Z","title":"Charting 15 years of progress in deep learning for speech emotion recognition: A replication study","version":1},"reference_index":47,"source":"pdf_text","source_observed_at":"2026-08-06T05:03:19.627042Z"},"links":{"cited_paper":"/paper/2307.09288","citing_paper":"/paper/2508.02448"},"observation_digest":"sha256:a1c5e99da0b12bb638d6511db8cbe90b38c56ad8bfd1c6b0f9aa5967335a3ff8","observation_id":"21584cc0-dafd-4e53-822f-e239d36b7728","resolution":{"observed_at":"2026-08-06T05:03:19.627042Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2407.21783","last_updated":"2024-11-23T23:27:33Z","snapshot_observed_at":"2026-07-06T18:55:11.576666Z","submitted_at":"2024-07-31T17:54:27Z","title":"The Llama 3 Herd of Models","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2407.21783","snapshot_observed_at":"2026-08-06T05:03:19.636024Z","title":"The Llama 3 herd of models,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2508.02448","last_updated":"2025-08-04T14:09:53Z","snapshot_observed_at":"2026-08-06T05:03:05.531743Z","submitted_at":"2025-08-04T14:09:53Z","title":"Charting 15 years of progress in deep learning for speech emotion recognition: A replication study","version":1},"reference_index":48,"source":"pdf_text","source_observed_at":"2026-08-06T05:03:19.636024Z"},"links":{"cited_paper":"/paper/2407.21783","citing_paper":"/paper/2508.02448"},"observation_digest":"sha256:f10e08335b1d914303d20425d7224358e1bde0ac4296c82e9e265d6aefef816f","observation_id":"2d4fcd32-74b8-4368-bd8e-3d83a58013dd","resolution":{"observed_at":"2026-08-06T05:03:19.636024Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2310.06825","last_updated":"2023-10-10T17:54:58Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2023-10-10T17:54:58Z","title":"Mistral 7B","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2310.06825","snapshot_observed_at":"2026-08-06T05:03:19.646510Z","title":"Mistral 7b,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2508.02448","last_updated":"2025-08-04T14:09:53Z","snapshot_observed_at":"2026-08-06T05:03:05.531743Z","submitted_at":"2025-08-04T14:09:53Z","title":"Charting 15 years of progress in deep learning for speech emotion recognition: A replication study","version":1},"reference_index":49,"source":"pdf_text","source_observed_at":"2026-08-06T05:03:19.646510Z"},"links":{"cited_paper":"/paper/2310.06825","citing_paper":"/paper/2508.02448"},"observation_digest":"sha256:58b45f212b02f945b38e51246d0f64a9045def5d0b915aca87ff4455d949371a","observation_id":"de4aa256-9ad1-41bb-8353-11cbe5877b20","resolution":{"observed_at":"2026-08-06T05:03:19.646510Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T05:03:29.708350Z","title":"LoRA: Low-rank adaptation of large language models,","venue":null,"work_id":"f046c580-a909-4038-814f-a0272aaa932a","year":2022},"citing_paper":{"arxiv_id":"2508.02448","last_updated":"2025-08-04T14:09:53Z","snapshot_observed_at":"2026-08-06T05:03:05.531743Z","submitted_at":"2025-08-04T14:09:53Z","title":"Charting 15 years of progress in deep learning for speech emotion recognition: A replication study","version":1},"reference_index":50,"source":"pdf_text","source_observed_at":"2026-08-06T05:03:19.657522Z"},"links":{"citing_paper":"/paper/2508.02448"},"observation_digest":"sha256:ad53c94e920f5fe00a3a5f054eb0f84729e2a5a6209e741776f46cfe54e235c2","observation_id":"bd718021-0a75-469d-a0f7-a7ca82eaaa92","resolution":{"observed_at":"2026-08-06T05:03:29.820184Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T05:03:29.416612Z","title":"A curated dataset of urban scenes for audio-visual scene analysis,","venue":null,"work_id":"61d45bbb-1998-486b-b835-dc29f53699e3","year":2021},"citing_paper":{"arxiv_id":"2508.02448","last_updated":"2025-08-04T14:09:53Z","snapshot_observed_at":"2026-08-06T05:03:05.531743Z","submitted_at":"2025-08-04T14:09:53Z","title":"Charting 15 years of progress in deep learning for speech emotion recognition: A replication study","version":1},"reference_index":51,"source":"pdf_text","source_observed_at":"2026-08-06T05:03:19.677420Z"},"links":{"citing_paper":"/paper/2508.02448"},"observation_digest":"sha256:5d9df151b9da8a407153125824a7d7da2fce5a2a010d43aafb332076f33cd7a1","observation_id":"e52ef06c-fed7-4052-8a3f-e26ddb41bfd6","resolution":{"observed_at":"2026-08-06T05:03:29.579282Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T05:03:29.209503Z","title":"Enrolment-based person- alisation for improving individual-level fairness in speech emotion recognition,","venue":null,"work_id":"a81972db-4816-4a5e-9605-089d664ed115","year":2024},"citing_paper":{"arxiv_id":"2508.02448","last_updated":"2025-08-04T14:09:53Z","snapshot_observed_at":"2026-08-06T05:03:05.531743Z","submitted_at":"2025-08-04T14:09:53Z","title":"Charting 15 years of progress in deep learning for speech emotion recognition: A replication study","version":1},"reference_index":52,"source":"pdf_text","source_observed_at":"2026-08-06T05:03:19.691640Z"},"links":{"citing_paper":"/paper/2508.02448"},"observation_digest":"sha256:323f1858028de35db1b9fad357fcbd61541a64b6fc7d35d5183ec1842901ce08","observation_id":"9724ba06-5131-45cd-9576-a93777d65767","resolution":{"observed_at":"2026-08-06T05:03:29.303436Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T05:03:29.020055Z","title":"What size test set gives good error rate estimates?","venue":null,"work_id":"5299a83c-55c2-462b-962f-8ff3ed9120e1","year":1998},"citing_paper":{"arxiv_id":"2508.02448","last_updated":"2025-08-04T14:09:53Z","snapshot_observed_at":"2026-08-06T05:03:05.531743Z","submitted_at":"2025-08-04T14:09:53Z","title":"Charting 15 years of progress in deep learning for speech emotion recognition: A replication study","version":1},"reference_index":53,"source":"pdf_text","source_observed_at":"2026-08-06T05:03:19.702540Z"},"links":{"citing_paper":"/paper/2508.02448"},"observation_digest":"sha256:ab5a36440f4895efbd4b5cafa4db86ee60e2ce5fb0b39d1297d63f6bbde82b4a","observation_id":"ee28d161-60b9-46bc-92fb-c1c71894eb40","resolution":{"observed_at":"2026-08-06T05:03:29.115752Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T05:03:28.808642Z","title":"A formula for the gini coefficient,","venue":null,"work_id":"2dca3743-ffaf-4d2c-8ae8-4c64214433a0","year":1979},"citing_paper":{"arxiv_id":"2508.02448","last_updated":"2025-08-04T14:09:53Z","snapshot_observed_at":"2026-08-06T05:03:05.531743Z","submitted_at":"2025-08-04T14:09:53Z","title":"Charting 15 years of progress in deep learning for speech emotion recognition: A replication study","version":1},"reference_index":54,"source":"pdf_text","source_observed_at":"2026-08-06T05:03:19.717678Z"},"links":{"citing_paper":"/paper/2508.02448"},"observation_digest":"sha256:8b0fbf0896c241f06a176f2132b826dd009b178641aea4319ec5e35e8e447f78","observation_id":"08875a01-7667-4041-9f7e-d81f92c9299d","resolution":{"observed_at":"2026-08-06T05:03:28.911427Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T05:03:28.632061Z","title":"Shalev-Shwartz and S","venue":null,"work_id":"f240cf36-9b81-4728-bf85-88cdcacb4e5d","year":2014},"citing_paper":{"arxiv_id":"2508.02448","last_updated":"2025-08-04T14:09:53Z","snapshot_observed_at":"2026-08-06T05:03:05.531743Z","submitted_at":"2025-08-04T14:09:53Z","title":"Charting 15 years of progress in deep learning for speech emotion recognition: A replication study","version":1},"reference_index":55,"source":"pdf_text","source_observed_at":"2026-08-06T05:03:19.731173Z"},"links":{"citing_paper":"/paper/2508.02448"},"observation_digest":"sha256:5a19e883bd6fa22a7ed6b8d966f72c823952131186b55143a2daab68f2bd6d65","observation_id":"82549b11-8441-4ded-8e48-d7e133ea4819","resolution":{"observed_at":"2026-08-06T05:03:28.721923Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T05:03:28.443839Z","title":"Underspecification presents challenges for credibility in modern machine learning,","venue":null,"work_id":"c90ed1f6-8992-4871-ae6f-a1dd57d1cc7d","year":2022},"citing_paper":{"arxiv_id":"2508.02448","last_updated":"2025-08-04T14:09:53Z","snapshot_observed_at":"2026-08-06T05:03:05.531743Z","submitted_at":"2025-08-04T14:09:53Z","title":"Charting 15 years of progress in deep learning for speech emotion recognition: A replication study","version":1},"reference_index":56,"source":"pdf_text","source_observed_at":"2026-08-06T05:03:19.744077Z"},"links":{"citing_paper":"/paper/2508.02448"},"observation_digest":"sha256:097a818ba78a333d3f4cd6a4343dc277680ab285e211b714c06f748143264b7f","observation_id":"81ebef54-8ee1-4d6e-80e8-4f7207303c8e","resolution":{"observed_at":"2026-08-06T05:03:28.515732Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T05:03:28.229563Z","title":"On the power of curriculum learning in training deep networks,","venue":null,"work_id":"5f233e82-db68-468a-a21b-78832007f4cc","year":2019},"citing_paper":{"arxiv_id":"2508.02448","last_updated":"2025-08-04T14:09:53Z","snapshot_observed_at":"2026-08-06T05:03:05.531743Z","submitted_at":"2025-08-04T14:09:53Z","title":"Charting 15 years of progress in deep learning for speech emotion recognition: A replication study","version":1},"reference_index":57,"source":"pdf_text","source_observed_at":"2026-08-06T05:03:19.781937Z"},"links":{"citing_paper":"/paper/2508.02448"},"observation_digest":"sha256:056205155a48fc2b2a4739b75ec6b560b079d1847949be3c8c3c356e564e20e2","observation_id":"43a78f07-3daa-4788-a861-5fd2d52e6ad0","resolution":{"observed_at":"2026-08-06T05:03:28.335926Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2411.00973","last_updated":"2024-11-01T18:55:31Z","snapshot_observed_at":"2026-07-06T19:43:50.724897Z","submitted_at":"2024-11-01T18:55:31Z","title":"Does the Definition of Difficulty Matter? Scoring Functions and their Role for Curriculum Learning","version":1},"cited_work":{"arxiv_id":"2411.00973","doi":null,"metadata_source":"pith","pith_arxiv_id":"2411.00973","snapshot_observed_at":"2026-08-06T05:03:23.105262Z","title":"Does the Definition of Difficulty Matter? Scoring Functions and their Role for Curriculum Learning","venue":"cs.LG","work_id":"3982f158-2744-41d5-801e-4f9c709cb3e6","year":2024},"citing_paper":{"arxiv_id":"2508.02448","last_updated":"2025-08-04T14:09:53Z","snapshot_observed_at":"2026-08-06T05:03:05.531743Z","submitted_at":"2025-08-04T14:09:53Z","title":"Charting 15 years of progress in deep learning for speech emotion recognition: A replication study","version":1},"reference_index":58,"source":"pdf_text","source_observed_at":"2026-08-06T05:03:19.880732Z"},"links":{"cited_paper":"/paper/2411.00973","citing_paper":"/paper/2508.02448"},"observation_digest":"sha256:4652646e2f8f87c0fb42b2303323bbdd6b457b8ce9e2b66a170358509c3fa07a","observation_id":"a5f2549b-9788-4870-89a9-8b59e0638e4b","resolution":{"observed_at":"2026-08-06T05:03:23.242678Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T05:03:27.976321Z","title":"Scalable hyperparameter transfer learning,","venue":null,"work_id":"02a9e05a-0983-4daa-82c3-8b15914e0a51","year":2018},"citing_paper":{"arxiv_id":"2508.02448","last_updated":"2025-08-04T14:09:53Z","snapshot_observed_at":"2026-08-06T05:03:05.531743Z","submitted_at":"2025-08-04T14:09:53Z","title":"Charting 15 years of progress in deep learning for speech emotion recognition: A replication study","version":1},"reference_index":59,"source":"pdf_text","source_observed_at":"2026-08-06T05:03:19.979770Z"},"links":{"citing_paper":"/paper/2508.02448"},"observation_digest":"sha256:c8a44f1f1f33d379a9f0aef74bef21b101d15e31846333bca71459947112be92","observation_id":"dae10e57-27ab-4095-b50e-5094d5cb4d3f","resolution":{"observed_at":"2026-08-06T05:03:28.084329Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T05:03:27.746719Z","title":"Similarity of neural network representations revisited,","venue":null,"work_id":"2e6adf00-5c64-4ee8-a8d7-59b843ca474d","year":2019},"citing_paper":{"arxiv_id":"2508.02448","last_updated":"2025-08-04T14:09:53Z","snapshot_observed_at":"2026-08-06T05:03:05.531743Z","submitted_at":"2025-08-04T14:09:53Z","title":"Charting 15 years of progress in deep learning for speech emotion recognition: A replication study","version":1},"reference_index":60,"source":"pdf_text","source_observed_at":"2026-08-06T05:03:20.054791Z"},"links":{"citing_paper":"/paper/2508.02448"},"observation_digest":"sha256:8153831b07866c369b610f4b57e1a8675523d63db8d171f45b6c5a4d48c0acc0","observation_id":"26caac61-68fc-4eac-baab-c2351cbafb40","resolution":{"observed_at":"2026-08-06T05:03:27.823419Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T05:03:27.545575Z","title":"Deep learning of representations for unsupervised and transfer learning,","venue":null,"work_id":"b1ddd76e-12a6-4873-9996-12fb44f08710","year":2012},"citing_paper":{"arxiv_id":"2508.02448","last_updated":"2025-08-04T14:09:53Z","snapshot_observed_at":"2026-08-06T05:03:05.531743Z","submitted_at":"2025-08-04T14:09:53Z","title":"Charting 15 years of progress in deep learning for speech emotion recognition: A replication study","version":1},"reference_index":61,"source":"pdf_text","source_observed_at":"2026-08-06T05:03:20.184801Z"},"links":{"citing_paper":"/paper/2508.02448"},"observation_digest":"sha256:d1783ad52003d87e1250effb07615a7badc6acea9d1cd6b34173716cb4e012a8","observation_id":"9e6c16e1-e0e5-42a2-96f1-8ae7db0202a5","resolution":{"observed_at":"2026-08-06T05:03:27.614547Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2007.11154","last_updated":"2020-11-13T19:09:09Z","snapshot_observed_at":"2026-08-07T10:59:37.724632Z","submitted_at":"2020-07-22T01:31:44Z","title":"Rethinking CNN Models for Audio Classification","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2007.11154","snapshot_observed_at":"2026-08-06T05:03:20.280689Z","title":"Rethinking cnn models for audio classification,","venue":null,"work_id":null,"year":2007},"citing_paper":{"arxiv_id":"2508.02448","last_updated":"2025-08-04T14:09:53Z","snapshot_observed_at":"2026-08-06T05:03:05.531743Z","submitted_at":"2025-08-04T14:09:53Z","title":"Charting 15 years of progress in deep learning for speech emotion recognition: A replication study","version":1},"reference_index":62,"source":"pdf_text","source_observed_at":"2026-08-06T05:03:20.280689Z"},"links":{"cited_paper":"/paper/2007.11154","citing_paper":"/paper/2508.02448"},"observation_digest":"sha256:6bc0b4a5609790e3e6f6a124003fa5651e2d9cfa155cd5b681a266b54582e489","observation_id":"b90c8b98-a3a0-43cf-86ed-8e479b2a4bb1","resolution":{"observed_at":"2026-08-06T05:03:20.280689Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T05:03:27.352479Z","title":"What is being transferred in transfer learning?","venue":null,"work_id":"806ccd18-8d20-45ee-bf11-94e4a2775f90","year":2020},"citing_paper":{"arxiv_id":"2508.02448","last_updated":"2025-08-04T14:09:53Z","snapshot_observed_at":"2026-08-06T05:03:05.531743Z","submitted_at":"2025-08-04T14:09:53Z","title":"Charting 15 years of progress in deep learning for speech emotion recognition: A replication study","version":1},"reference_index":63,"source":"pdf_text","source_observed_at":"2026-08-06T05:03:20.381035Z"},"links":{"citing_paper":"/paper/2508.02448"},"observation_digest":"sha256:4c508620a02c9f9647f3efaaaad4db6beb0b7a456ef7fd0c3fbba70bb398be07","observation_id":"0312dece-7b8f-4f6e-bf13-553b1f9bcdb5","resolution":{"observed_at":"2026-08-06T05:03:27.463993Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T05:03:27.141958Z","title":"Acoustic profiles in vocal emotion expression.,","venue":null,"work_id":"fb4f5107-9759-45c4-8ead-5faeef79fb80","year":1996},"citing_paper":{"arxiv_id":"2508.02448","last_updated":"2025-08-04T14:09:53Z","snapshot_observed_at":"2026-08-06T05:03:05.531743Z","submitted_at":"2025-08-04T14:09:53Z","title":"Charting 15 years of progress in deep learning for speech emotion recognition: A replication study","version":1},"reference_index":64,"source":"pdf_text","source_observed_at":"2026-08-06T05:03:20.500209Z"},"links":{"citing_paper":"/paper/2508.02448"},"observation_digest":"sha256:0519692bf05d5ac07d69aa7c33f7991caced17bcaae3056361d82f738a3516d7","observation_id":"ee1d35ff-0990-47e3-9d03-5597d71d88a2","resolution":{"observed_at":"2026-08-06T05:03:27.242890Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2001.08361","last_updated":"2020-01-23T03:59:20Z","snapshot_observed_at":"2026-07-06T08:52:12.656082Z","submitted_at":"2020-01-23T03:59:20Z","title":"Scaling Laws for Neural Language Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2001.08361","snapshot_observed_at":"2026-08-06T05:03:20.587528Z","title":"Scaling laws for neural language models,","venue":null,"work_id":null,"year":2001},"citing_paper":{"arxiv_id":"2508.02448","last_updated":"2025-08-04T14:09:53Z","snapshot_observed_at":"2026-08-06T05:03:05.531743Z","submitted_at":"2025-08-04T14:09:53Z","title":"Charting 15 years of progress in deep learning for speech emotion recognition: A replication study","version":1},"reference_index":65,"source":"pdf_text","source_observed_at":"2026-08-06T05:03:20.587528Z"},"links":{"cited_paper":"/paper/2001.08361","citing_paper":"/paper/2508.02448"},"observation_digest":"sha256:24e32b2766c7983d9bf1ba56b2f05bd2a9cf696fe6fdfc17e003defd673962f9","observation_id":"8cdbf087-1872-46aa-a7d4-65cc6bd9f841","resolution":{"observed_at":"2026-08-06T05:03:20.587528Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2407.15672","last_updated":"2025-07-28T13:58:00Z","snapshot_observed_at":"2026-07-06T18:50:04.824067Z","submitted_at":"2024-07-22T14:41:29Z","title":"Computer Audition: From Task-Specific Machine Learning to Foundation Models","version":2},"cited_work":{"arxiv_id":"2407.15672","doi":null,"metadata_source":"pith","pith_arxiv_id":"2407.15672","snapshot_observed_at":"2026-08-06T05:03:22.877147Z","title":"Computer Audition: From Task-Specific Machine Learning to Foundation Models","venue":"cs.SD","work_id":"8b75dfde-048b-4632-942e-9508bfc3187e","year":2024},"citing_paper":{"arxiv_id":"2508.02448","last_updated":"2025-08-04T14:09:53Z","snapshot_observed_at":"2026-08-06T05:03:05.531743Z","submitted_at":"2025-08-04T14:09:53Z","title":"Charting 15 years of progress in deep learning for speech emotion recognition: A replication study","version":1},"reference_index":66,"source":"pdf_text","source_observed_at":"2026-08-06T05:03:20.694853Z"},"links":{"cited_paper":"/paper/2407.15672","citing_paper":"/paper/2508.02448"},"observation_digest":"sha256:067b2ccecc90f1fa26422b94189723bd3a9948f339c15e32dcbebf8bc7de2f29","observation_id":"557500d8-a3f1-4f94-bc00-04d03185c0f0","resolution":{"observed_at":"2026-08-06T05:03:22.962325Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T05:03:26.929799Z","title":"Can large language models aid in annotating speech emotional data? uncovering new frontiers [research frontier],","venue":null,"work_id":"fda26fbc-9653-4d27-b057-b12b082d5c52","year":2025},"citing_paper":{"arxiv_id":"2508.02448","last_updated":"2025-08-04T14:09:53Z","snapshot_observed_at":"2026-08-06T05:03:05.531743Z","submitted_at":"2025-08-04T14:09:53Z","title":"Charting 15 years of progress in deep learning for speech emotion recognition: A replication study","version":1},"reference_index":67,"source":"pdf_text","source_observed_at":"2026-08-06T05:03:20.837511Z"},"links":{"citing_paper":"/paper/2508.02448"},"observation_digest":"sha256:803137e35b3347b2927083908eb94f1174e284e987cb3fec729c008be46158d9","observation_id":"9a5d045f-0711-43bc-9225-a0d43aaf3647","resolution":{"observed_at":"2026-08-06T05:03:27.041394Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T05:03:26.720204Z","title":"Winner’s curse? on pace, progress, and empirical rigor,","venue":null,"work_id":"8b59ad0e-d8d1-4d6b-b122-b028f1bf6125","year":2018},"citing_paper":{"arxiv_id":"2508.02448","last_updated":"2025-08-04T14:09:53Z","snapshot_observed_at":"2026-08-06T05:03:05.531743Z","submitted_at":"2025-08-04T14:09:53Z","title":"Charting 15 years of progress in deep learning for speech emotion recognition: A replication study","version":1},"reference_index":68,"source":"pdf_text","source_observed_at":"2026-08-06T05:03:20.938232Z"},"links":{"citing_paper":"/paper/2508.02448"},"observation_digest":"sha256:fe86d6b335987c31a926424c48d4fdf7633d5b9f4aacfe53569b04ae331ce799","observation_id":"6aa1f68f-f1a7-4eb3-9eb9-0e8cfb812a0b","resolution":{"observed_at":"2026-08-06T05:03:26.809672Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T05:03:26.593263Z","title":"Troubling trends in machine learning scholarship: Some ml papers suffer from flaws that could mislead the public and stymie future research.,","venue":null,"work_id":"01b0f0b2-4580-48a1-95c3-15f995a678bd","year":2019},"citing_paper":{"arxiv_id":"2508.02448","last_updated":"2025-08-04T14:09:53Z","snapshot_observed_at":"2026-08-06T05:03:05.531743Z","submitted_at":"2025-08-04T14:09:53Z","title":"Charting 15 years of progress in deep learning for speech emotion recognition: A replication study","version":1},"reference_index":69,"source":"pdf_text","source_observed_at":"2026-08-06T05:03:21.025558Z"},"links":{"citing_paper":"/paper/2508.02448"},"observation_digest":"sha256:582187b497e0f6b7eda676f0d4e429c1efdfe3475508e99de7a5c1edd215d621","observation_id":"a7902f98-eb6d-4281-8907-7a4ee874fd61","resolution":{"observed_at":"2026-08-06T05:03:26.651612Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1910.05446","last_updated":"2020-06-16T00:58:12Z","snapshot_observed_at":"2026-08-06T08:58:02.295940Z","submitted_at":"2019-10-11T23:51:09Z","title":"On Empirical Comparisons of Optimizers for Deep Learning","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1910.05446","snapshot_observed_at":"2026-08-06T05:03:21.143206Z","title":"On empirical comparisons of optimizers for deep learning,","venue":null,"work_id":null,"year":1910},"citing_paper":{"arxiv_id":"2508.02448","last_updated":"2025-08-04T14:09:53Z","snapshot_observed_at":"2026-08-06T05:03:05.531743Z","submitted_at":"2025-08-04T14:09:53Z","title":"Charting 15 years of progress in deep learning for speech emotion recognition: A replication study","version":1},"reference_index":70,"source":"pdf_text","source_observed_at":"2026-08-06T05:03:21.143206Z"},"links":{"cited_paper":"/paper/1910.05446","citing_paper":"/paper/2508.02448"},"observation_digest":"sha256:ff7970654b12c03bb2d7e02b9c58abab53c84a57ae3c7233e97679bff8759758","observation_id":"48f6f2a4-3fb4-499a-9cf4-0f33040fa121","resolution":{"observed_at":"2026-08-06T05:03:21.143206Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T05:03:26.378217Z","title":"Unreproducible research is reproducible,","venue":null,"work_id":"765e8102-24e7-47cf-bf3b-85a638089136","year":2019},"citing_paper":{"arxiv_id":"2508.02448","last_updated":"2025-08-04T14:09:53Z","snapshot_observed_at":"2026-08-06T05:03:05.531743Z","submitted_at":"2025-08-04T14:09:53Z","title":"Charting 15 years of progress in deep learning for speech emotion recognition: A replication study","version":1},"reference_index":71,"source":"pdf_text","source_observed_at":"2026-08-06T05:03:21.218486Z"},"links":{"citing_paper":"/paper/2508.02448"},"observation_digest":"sha256:c7a0489a17c6b7fc8d122e6dbb4ac23d953d5c9efdadc41b24618d3665499805","observation_id":"6e497e63-4069-49b6-a63b-7dd12ec71bdf","resolution":{"observed_at":"2026-08-06T05:03:26.481829Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T05:03:26.190560Z","title":"Beyond deep learning: Charting the next frontiers of affective computing,","venue":null,"work_id":"fd8cdd08-f23d-41d5-ad8c-ebe12d5884d6","year":2024},"citing_paper":{"arxiv_id":"2508.02448","last_updated":"2025-08-04T14:09:53Z","snapshot_observed_at":"2026-08-06T05:03:05.531743Z","submitted_at":"2025-08-04T14:09:53Z","title":"Charting 15 years of progress in deep learning for speech emotion recognition: A replication study","version":1},"reference_index":72,"source":"pdf_text","source_observed_at":"2026-08-06T05:03:21.370321Z"},"links":{"citing_paper":"/paper/2508.02448"},"observation_digest":"sha256:a1543ea5d94783ee1851a57a9c6c0730d14dcee5aaaff8363bf9977b6136bfde","observation_id":"44ba4015-41eb-4ba4-b92c-df3c81ed36a0","resolution":{"observed_at":"2026-08-06T05:03:26.272093Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T05:03:26.011024Z","title":"Basic emotions,","venue":null,"work_id":"d730ba64-de36-4a7c-bbb0-61d6f60fe3c8","year":1999},"citing_paper":{"arxiv_id":"2508.02448","last_updated":"2025-08-04T14:09:53Z","snapshot_observed_at":"2026-08-06T05:03:05.531743Z","submitted_at":"2025-08-04T14:09:53Z","title":"Charting 15 years of progress in deep learning for speech emotion recognition: A replication study","version":1},"reference_index":73,"source":"pdf_text","source_observed_at":"2026-08-06T05:03:21.502683Z"},"links":{"citing_paper":"/paper/2508.02448"},"observation_digest":"sha256:0b1950b3c1c86532e930338aeb73fdad109abe497809417fe6f072b6ae486e5c","observation_id":"8c2fd22b-2e59-4996-9d1e-0d968eab38fb","resolution":{"observed_at":"2026-08-06T05:03:26.072177Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T05:03:25.840934Z","title":null,"venue":null,"work_id":"2a089d9d-7e63-4b28-bf72-13c5131e1d58","year":2017},"citing_paper":{"arxiv_id":"2508.02448","last_updated":"2025-08-04T14:09:53Z","snapshot_observed_at":"2026-08-06T05:03:05.531743Z","submitted_at":"2025-08-04T14:09:53Z","title":"Charting 15 years of progress in deep learning for speech emotion recognition: A replication study","version":1},"reference_index":74,"source":"pdf_text","source_observed_at":"2026-08-06T05:03:21.608418Z"},"links":{"citing_paper":"/paper/2508.02448"},"observation_digest":"sha256:ee6f4e449c578baca19a53b389e765ed5e3b1f0cd5269b7abbe650b0bb3c2f59","observation_id":"002e10c2-1783-4e9e-9c95-c3ed3fd7ad99","resolution":{"observed_at":"2026-08-06T05:03:25.885779Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T05:03:25.656867Z","title":"End-to-end speech emotion recognition using deep neural networks,","venue":null,"work_id":"0a57f9d5-f759-4124-baf9-0f4dd7ce0302","year":2018},"citing_paper":{"arxiv_id":"2508.02448","last_updated":"2025-08-04T14:09:53Z","snapshot_observed_at":"2026-08-06T05:03:05.531743Z","submitted_at":"2025-08-04T14:09:53Z","title":"Charting 15 years of progress in deep learning for speech emotion recognition: A replication study","version":1},"reference_index":75,"source":"pdf_text","source_observed_at":"2026-08-06T05:03:21.756624Z"},"links":{"citing_paper":"/paper/2508.02448"},"observation_digest":"sha256:3e31d34948f3eddb05386616601b357ec69ee72a97358b6905773e014a0b471f","observation_id":"8f3741fc-9170-4329-b9cc-73542e2be759","resolution":{"observed_at":"2026-08-06T05:03:25.724323Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T05:03:25.478090Z","title":"Speech emotion recognition using deep 1d & 2d cnn lstm networks,","venue":null,"work_id":"84a43cc4-8c1d-448c-b434-d5e6061ac6a5","year":2019},"citing_paper":{"arxiv_id":"2508.02448","last_updated":"2025-08-04T14:09:53Z","snapshot_observed_at":"2026-08-06T05:03:05.531743Z","submitted_at":"2025-08-04T14:09:53Z","title":"Charting 15 years of progress in deep learning for speech emotion recognition: A replication study","version":1},"reference_index":76,"source":"pdf_text","source_observed_at":"2026-08-06T05:03:21.849418Z"},"links":{"citing_paper":"/paper/2508.02448"},"observation_digest":"sha256:0f9587511cde8c2a2e5d7f636d0bfe02f4cf6ccc80f100ac2242b112c52429c9","observation_id":"2ca17b07-c16b-4d8a-a2b9-d70213058828","resolution":{"observed_at":"2026-08-06T05:03:25.558121Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T05:03:25.222963Z","title":"V oxpopuli: A large-scale multilingual speech corpus for representation learning, semi-supervised learning and interpretation,","venue":null,"work_id":"4bb1a47b-f703-46d6-81ec-3012a672f2f5","year":2021},"citing_paper":{"arxiv_id":"2508.02448","last_updated":"2025-08-04T14:09:53Z","snapshot_observed_at":"2026-08-06T05:03:05.531743Z","submitted_at":"2025-08-04T14:09:53Z","title":"Charting 15 years of progress in deep learning for speech emotion recognition: A replication study","version":1},"reference_index":77,"source":"pdf_text","source_observed_at":"2026-08-06T05:03:21.961338Z"},"links":{"citing_paper":"/paper/2508.02448"},"observation_digest":"sha256:68a93aff0a133a2bb8ee1b683d2bccd06d77218bc3e28edcb886c325ca580862","observation_id":"75a9af9f-8537-410b-809c-63da0040fbc1","resolution":{"observed_at":"2026-08-06T05:03:25.367123Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T05:03:25.045413Z","title":"Robust wav2vec 2.0: Analyzing Domain Shift in Self-Supervised Pre-Training,","venue":null,"work_id":"f6145c4f-05fb-457e-b2a8-13ec1eb02a75","year":2021},"citing_paper":{"arxiv_id":"2508.02448","last_updated":"2025-08-04T14:09:53Z","snapshot_observed_at":"2026-08-06T05:03:05.531743Z","submitted_at":"2025-08-04T14:09:53Z","title":"Charting 15 years of progress in deep learning for speech emotion recognition: A replication study","version":1},"reference_index":78,"source":"pdf_text","source_observed_at":"2026-08-06T05:03:22.110325Z"},"links":{"citing_paper":"/paper/2508.02448"},"observation_digest":"sha256:6fa51383b2ea4ab4ec3b95bddf55dcd121b9917cdf6f448f8bbb190aeffc9bb6","observation_id":"09d67d0f-c6d4-4047-8aa7-96cef23409fd","resolution":{"observed_at":"2026-08-06T05:03:25.127563Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T05:03:24.725320Z","title":"Mp3 and aac explained,","venue":null,"work_id":"18f36798-446e-4940-ab84-284a2a66f5c0","year":1999},"citing_paper":{"arxiv_id":"2508.02448","last_updated":"2025-08-04T14:09:53Z","snapshot_observed_at":"2026-08-06T05:03:05.531743Z","submitted_at":"2025-08-04T14:09:53Z","title":"Charting 15 years of progress in deep learning for speech emotion recognition: A replication study","version":1},"reference_index":79,"source":"pdf_text","source_observed_at":"2026-08-06T05:03:22.183466Z"},"links":{"citing_paper":"/paper/2508.02448"},"observation_digest":"sha256:0eab097961fa00ce747e43a9db1caaf666e3e52496efb5d32a4e9500b24c6642","observation_id":"366485df-b7de-4888-afa4-c6dd4b258146","resolution":{"observed_at":"2026-08-06T05:03:24.894328Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T05:03:24.409031Z","title":"High fidelity neural audio compression,","venue":null,"work_id":"9d5c325f-f77b-4a21-84b5-09f5cf20530d","year":2022},"citing_paper":{"arxiv_id":"2508.02448","last_updated":"2025-08-04T14:09:53Z","snapshot_observed_at":"2026-08-06T05:03:05.531743Z","submitted_at":"2025-08-04T14:09:53Z","title":"Charting 15 years of progress in deep learning for speech emotion recognition: A replication study","version":1},"reference_index":80,"source":"pdf_text","source_observed_at":"2026-08-06T05:03:22.254389Z"},"links":{"citing_paper":"/paper/2508.02448"},"observation_digest":"sha256:5b19c38a4dbca02c72363abf1ef8e068a10c281fbbd2dfb6b083ed05991d5449","observation_id":"5111cf98-f387-40f5-8be5-29d5bd67e7d4","resolution":{"observed_at":"2026-08-06T05:03:24.511956Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T05:03:24.109810Z","title":"Semanticodec: An ultra low bitrate semantic audio codec for general sound,","venue":null,"work_id":"0ad8c28e-553e-4b65-b296-b4dbe1ce8dfd","year":2024},"citing_paper":{"arxiv_id":"2508.02448","last_updated":"2025-08-04T14:09:53Z","snapshot_observed_at":"2026-08-06T05:03:05.531743Z","submitted_at":"2025-08-04T14:09:53Z","title":"Charting 15 years of progress in deep learning for speech emotion recognition: A replication study","version":1},"reference_index":81,"source":"pdf_text","source_observed_at":"2026-08-06T05:03:22.360226Z"},"links":{"citing_paper":"/paper/2508.02448"},"observation_digest":"sha256:bb58697dd954132d4e85c8436948545d661155553f989cd1104a80ebb343b5f3","observation_id":"f9dce89f-c40a-4e17-bb14-135636930f05","resolution":{"observed_at":"2026-08-06T05:03:24.280485Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}}],"paper":{"arxiv_id":"2508.02448","last_updated":"2025-08-04T14:09:53Z","latest_version":1,"primary_category":"cs.SD","snapshot_observed_at":"2026-08-06T05:03:05.531743Z","submitted_at":"2025-08-04T14:09:53Z","title":"Charting 15 years of progress in deep learning for speech emotion recognition: A replication study"},"reference_resolution":{"displayed":81,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":14,"verified_exact":4,"verified_fuzzy":63},"total_outbound_references":81},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"thesis":"As of 10 August 2026, this Paper Citation Record lists 81 of 81 outbound references and 0 inbound Pith citation observations for arXiv:2508.02448."}