{"as_of":"2026-08-10T04:02:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:10e5ec754332077c710a5938e666535aa36a492a413bf9e57917b2f5b7993b3c","coverage":[{"denominator":74,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":74,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-05T19:01:25.208175Z","state":"measured"},{"denominator":78,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":78,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-09T06:31:02.800959+00:00","state":"measured"},{"denominator":4,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":4,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-08T19:15:44.027980Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"arxiv_reference","source_observed_at":"2026-07-04T12:49:52.016080Z","state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2508.14130","last_updated":"2025-08-19T06:58:16Z","snapshot_observed_at":"2026-08-09T19:23:14.500136Z","submitted_at":"2025-08-19T06:58:16Z","title":"EmoSLLM: Parameter-Efficient Adaptation of LLMs for Speech Emotion Recognition","version":1},"cited_work":{"arxiv_id":"2508.14130","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2508.14130","snapshot_observed_at":"2026-07-04T12:49:52.016080Z","title":"arXiv preprint arXiv:2508.14130 (2025)","venue":null,"work_id":"705546a3-3ada-45fe-bb93-ffa4110af366","year":2025},"citing_paper":{"arxiv_id":"2512.07571","last_updated":"2026-04-06T08:39:08Z","snapshot_observed_at":"2026-07-06T22:38:03.983093Z","submitted_at":"2025-12-08T14:05:40Z","title":"A Simple Method to Enhance Pre-trained Language Models with Speech Tokens for Classification","version":2},"reference_index":31,"source":"arxiv_source","source_observed_at":"2026-05-17T00:46:08.921194Z"},"links":{"cited_paper":"/paper/2508.14130","citing_paper":"/paper/2512.07571"},"observation_digest":"sha256:936b46320dfdb66223911d165b6683a78bab0671d0fa923ffe9cc091c63306a5","observation_id":"b4b295d5-5ee6-4bd4-9d36-e64715d0856e","resolution":{"observed_at":"2026-05-17T00:48:45.965142Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2508.14130","last_updated":"2025-08-19T06:58:16Z","snapshot_observed_at":"2026-08-09T19:23:14.500136Z","submitted_at":"2025-08-19T06:58:16Z","title":"EmoSLLM: Parameter-Efficient Adaptation of LLMs for Speech Emotion Recognition","version":1},"cited_work":{"arxiv_id":"2508.14130","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2508.14130","snapshot_observed_at":"2026-07-04T12:49:52.016080Z","title":"arXiv preprint arXiv:2508.14130 (2025)","venue":null,"work_id":"705546a3-3ada-45fe-bb93-ffa4110af366","year":2025},"citing_paper":{"arxiv_id":"2606.24941","last_updated":"2026-07-27T15:49:33Z","snapshot_observed_at":"2026-08-07T07:53:29.622172Z","submitted_at":"2026-06-22T20:45:49Z","title":"EmotionAI: A Privacy-Preserving Computational Intelligence Pipeline for Speech-Emotion-Grounded Conversational Analysis","version":1},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-06-26T06:05:49.433814Z"},"links":{"cited_paper":"/paper/2508.14130","citing_paper":"/paper/2606.24941"},"observation_digest":"sha256:ec3104e2c7e68b449d18484670f397537f0aaec678163257a5b000b0c7e39db7","observation_id":"a30cd5cf-f01a-4bef-a6a5-42185b6b7e27","resolution":{"observed_at":"2026-07-04T12:49:52.017420Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2508.14130","last_updated":"2025-08-19T06:58:16Z","snapshot_observed_at":"2026-08-09T19:23:14.500136Z","submitted_at":"2025-08-19T06:58:16Z","title":"EmoSLLM: Parameter-Efficient Adaptation of LLMs for Speech Emotion Recognition","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2508.14130","snapshot_observed_at":"2026-08-02T10:26:25.288372Z","title":"arXiv preprint arXiv:2508.14130 (2025)","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2606.24941","last_updated":"2026-07-27T15:49:33Z","snapshot_observed_at":"2026-08-07T07:53:29.622172Z","submitted_at":"2026-06-22T20:45:49Z","title":"EmotionAI: A Privacy-Preserving Computational Intelligence Pipeline for Speech-Emotion-Grounded Conversational Analysis","version":2},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-02T10:26:25.288372Z"},"links":{"cited_paper":"/paper/2508.14130","citing_paper":"/paper/2606.24941"},"observation_digest":"sha256:dc856437e2c37fefa9e05008943603c03aeed77d098f78067a172f1e4d103e01","observation_id":"a546dc66-a3a6-4edb-b707-b4e3929b3445","resolution":{"observed_at":"2026-08-02T10:26:25.288372Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2508.14130","last_updated":"2025-08-19T06:58:16Z","snapshot_observed_at":"2026-08-09T19:23:14.500136Z","submitted_at":"2025-08-19T06:58:16Z","title":"EmoSLLM: Parameter-Efficient Adaptation of LLMs for Speech Emotion Recognition","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2508.14130","snapshot_observed_at":"2026-08-08T19:15:44.027980Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2608.04351","last_updated":"2026-08-05T01:50:37Z","snapshot_observed_at":"2026-08-08T23:11:30.376300Z","submitted_at":"2026-08-05T01:50:37Z","title":"HyPASE: Hyperbolic Geometry for Parameter-Efficient Speech Emotion Fine-Tuning Framework for Large Audio-Language Models","version":1},"reference_index":37,"source":"pdf_text","source_observed_at":"2026-08-08T19:15:44.027980Z"},"links":{"cited_paper":"/paper/2508.14130","citing_paper":"/paper/2608.04351"},"observation_digest":"sha256:4a55e02a2db8382dceda95674c8deaf6400267e1751a954f391b5c2fb52de0fd","observation_id":"9f692828-520e-44a0-881b-776fcf55bcdb","resolution":{"observed_at":"2026-08-08T19:15:44.027980Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"links":{"evidence":"/evidence","html":"/paper/2508.14130/citation-record","integrity":"/paper/2508.14130/integrity","json":"/paper/2508.14130/citation-record.json","paper":"/paper/2508.14130"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T19:01:46.685037Z","title":"Alsaad, Yusra Azhar, and Yasser Al Nasser.Depression in Children","venue":null,"work_id":"b3295aa6-0fa2-4b75-b9b8-0b5867ea892f","year":2023},"citing_paper":{"arxiv_id":"2508.14130","last_updated":"2025-08-19T06:58:16Z","snapshot_observed_at":"2026-08-09T19:23:14.500136Z","submitted_at":"2025-08-19T06:58:16Z","title":"EmoSLLM: Parameter-Efficient Adaptation of LLMs for Speech Emotion Recognition","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-05T19:01:19.919619Z"},"links":{"citing_paper":"/paper/2508.14130"},"observation_digest":"sha256:97a280e3cf4e2c7127c58211380b0a56f83d59649271d665576983f74ae8d7af","observation_id":"e4ac4cc6-9f83-4606-81f5-5df0af1a7f74","resolution":{"observed_at":"2026-08-05T19:01:46.689700Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T19:01:46.665231Z","title":"Self-supervised learning from images with a joint- embedding predictive architecture","venue":null,"work_id":"cb712e6f-b571-483c-a526-020c6f242a01","year":2023},"citing_paper":{"arxiv_id":"2508.14130","last_updated":"2025-08-19T06:58:16Z","snapshot_observed_at":"2026-08-09T19:23:14.500136Z","submitted_at":"2025-08-19T06:58:16Z","title":"EmoSLLM: Parameter-Efficient Adaptation of LLMs for Speech Emotion Recognition","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-05T19:01:19.966654Z"},"links":{"citing_paper":"/paper/2508.14130"},"observation_digest":"sha256:f4ed872cf21a74927b0f4d60be5f3bc82bc1ab64bb42476a09a6707bb007b235","observation_id":"d33317e0-c168-428b-bcd9-5d754b000091","resolution":{"observed_at":"2026-08-05T19:01:46.670936Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T19:01:46.647175Z","title":"vq-wav2vec: Self-supervised learning of discrete speech representations","venue":null,"work_id":"fbe82906-7716-48af-8d00-cdc6eff74c0f","year":2020},"citing_paper":{"arxiv_id":"2508.14130","last_updated":"2025-08-19T06:58:16Z","snapshot_observed_at":"2026-08-09T19:23:14.500136Z","submitted_at":"2025-08-19T06:58:16Z","title":"EmoSLLM: Parameter-Efficient Adaptation of LLMs for Speech Emotion Recognition","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-05T19:01:20.015139Z"},"links":{"citing_paper":"/paper/2508.14130"},"observation_digest":"sha256:f55a9213fca86e189966c0a5a3405b434ebc2073ee133622ea1020bd5ba8a894","observation_id":"36424f8d-492c-4a38-bfc6-52b72e0ad2fc","resolution":{"observed_at":"2026-08-05T19:01:46.652213Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2006.11477","last_updated":"2020-10-22T06:09:10Z","snapshot_observed_at":"2026-08-07T05:13:16.889179Z","submitted_at":"2020-06-20T02:35:02Z","title":"wav2vec 2.0: A Framework for Self-Supervised Learning of Speech Representations","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2006.11477","snapshot_observed_at":"2026-08-05T19:01:20.124665Z","title":"wav2vec 2.0: A framework for self-supervised learning of speech representations","venue":null,"work_id":null,"year":2006},"citing_paper":{"arxiv_id":"2508.14130","last_updated":"2025-08-19T06:58:16Z","snapshot_observed_at":"2026-08-09T19:23:14.500136Z","submitted_at":"2025-08-19T06:58:16Z","title":"EmoSLLM: Parameter-Efficient Adaptation of LLMs for Speech Emotion Recognition","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-05T19:01:20.124665Z"},"links":{"cited_paper":"/paper/2006.11477","citing_paper":"/paper/2508.14130"},"observation_digest":"sha256:e1f03a2e72fff3825e7852db6bba66c9adbe4ece648fcf801272e314835ed437","observation_id":"f3095a81-f6c5-4f8d-88aa-f88f294afb2c","resolution":{"observed_at":"2026-08-05T19:01:20.124665Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T19:01:46.628402Z","title":"VICReg: Variance-invariance-covariance regular- ization for self-supervised learning","venue":null,"work_id":"89f8dcf2-a656-41c5-a6b9-73f775237333","year":2022},"citing_paper":{"arxiv_id":"2508.14130","last_updated":"2025-08-19T06:58:16Z","snapshot_observed_at":"2026-08-09T19:23:14.500136Z","submitted_at":"2025-08-19T06:58:16Z","title":"EmoSLLM: Parameter-Efficient Adaptation of LLMs for Speech Emotion Recognition","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-05T19:01:20.212739Z"},"links":{"citing_paper":"/paper/2508.14130"},"observation_digest":"sha256:87f24eb25e9c2d59838d7130eb2d86020ab75f232aa8687e331c38836af96d35","observation_id":"f6ea7c20-042d-4a93-a0c3-4e98dd316dd4","resolution":{"observed_at":"2026-08-05T19:01:46.634597Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T19:01:46.608926Z","title":"Revisiting feature prediction for learning visual representations from video","venue":null,"work_id":"8a63eff7-6471-4d9b-b895-8db8cff6b7c0","year":2024},"citing_paper":{"arxiv_id":"2508.14130","last_updated":"2025-08-19T06:58:16Z","snapshot_observed_at":"2026-08-09T19:23:14.500136Z","submitted_at":"2025-08-19T06:58:16Z","title":"EmoSLLM: Parameter-Efficient Adaptation of LLMs for Speech Emotion Recognition","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-05T19:01:20.290655Z"},"links":{"citing_paper":"/paper/2508.14130"},"observation_digest":"sha256:9524ec8a5da29d5f7c917f8fc2a51ba359721c5f42c167a86c8a6af180769e70","observation_id":"3df58c14-0e90-4e56-afed-c010015acd68","resolution":{"observed_at":"2026-08-05T19:01:46.614173Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T19:01:46.592408Z","title":null,"venue":null,"work_id":"244e70c1-e542-4b45-89d1-fdea04fe28a0","year":2024},"citing_paper":{"arxiv_id":"2508.14130","last_updated":"2025-08-19T06:58:16Z","snapshot_observed_at":"2026-08-09T19:23:14.500136Z","submitted_at":"2025-08-19T06:58:16Z","title":"EmoSLLM: Parameter-Efficient Adaptation of LLMs for Speech Emotion Recognition","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-05T19:01:20.364384Z"},"links":{"citing_paper":"/paper/2508.14130"},"observation_digest":"sha256:9575a00bc39ebd7cc2a92384378fbc070734c9d2349b0a0947b19bc7cf69b2c9","observation_id":"cbffb741-49e2-448f-8109-0428c724d434","resolution":{"observed_at":"2026-08-05T19:01:46.597891Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T19:01:46.570395Z","title":"Unsupervised learning of visual features by contrasting cluster assignments","venue":null,"work_id":"a4ccb9a4-e7dd-4b09-bce8-376d7f5f335c","year":2020},"citing_paper":{"arxiv_id":"2508.14130","last_updated":"2025-08-19T06:58:16Z","snapshot_observed_at":"2026-08-09T19:23:14.500136Z","submitted_at":"2025-08-19T06:58:16Z","title":"EmoSLLM: Parameter-Efficient Adaptation of LLMs for Speech Emotion Recognition","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-05T19:01:20.413028Z"},"links":{"citing_paper":"/paper/2508.14130"},"observation_digest":"sha256:8cc69664ff5f4d4b27e978a2abaf8249a8e4aac884268a4910dab95bb45e22f2","observation_id":"2f391802-f54f-490c-866f-8b902bacee4a","resolution":{"observed_at":"2026-08-05T19:01:46.576531Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T19:01:20.485952Z","title":"Wavlm: Large-scale self-supervised pre-training for full stack speech processing","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2508.14130","last_updated":"2025-08-19T06:58:16Z","snapshot_observed_at":"2026-08-09T19:23:14.500136Z","submitted_at":"2025-08-19T06:58:16Z","title":"EmoSLLM: Parameter-Efficient Adaptation of LLMs for Speech Emotion Recognition","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-05T19:01:20.485952Z"},"links":{"citing_paper":"/paper/2508.14130"},"observation_digest":"sha256:873cf1da77430e6e4a62aa3321f09b082f65cd7c4c5d282a61f196c0a720262e","observation_id":"15629ce6-2c4a-4170-ad9d-9de93168ef0e","resolution":{"observed_at":"2026-08-05T19:01:20.485952Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T19:01:46.552823Z","title":"Wavlm: Large-scale self-supervised pre-training for full stack speech processing","venue":null,"work_id":"5a80add7-0fc4-4e79-8b22-1ef737ef9a5b","year":2021},"citing_paper":{"arxiv_id":"2508.14130","last_updated":"2025-08-19T06:58:16Z","snapshot_observed_at":"2026-08-09T19:23:14.500136Z","submitted_at":"2025-08-19T06:58:16Z","title":"EmoSLLM: Parameter-Efficient Adaptation of LLMs for Speech Emotion Recognition","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-05T19:01:20.585767Z"},"links":{"citing_paper":"/paper/2508.14130"},"observation_digest":"sha256:b72bb16bac7bec414d36855837ba777a94f720fb0e9d79f421c98d6b9f842073","observation_id":"f5fd2387-655e-4d16-b744-3e1e3b93e39e","resolution":{"observed_at":"2026-08-05T19:01:46.557915Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T19:01:46.537300Z","title":"BEATs: Audio pre-training with acoustic tokenizers","venue":null,"work_id":"8a666270-c310-408c-a227-661968336fa2","year":2023},"citing_paper":{"arxiv_id":"2508.14130","last_updated":"2025-08-19T06:58:16Z","snapshot_observed_at":"2026-08-09T19:23:14.500136Z","submitted_at":"2025-08-19T06:58:16Z","title":"EmoSLLM: Parameter-Efficient Adaptation of LLMs for Speech Emotion Recognition","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-05T19:01:20.660752Z"},"links":{"citing_paper":"/paper/2508.14130"},"observation_digest":"sha256:3047c3dfddc6fd12f39c60ccc4e2fa4030176bfac5dad188e73e2893932491f2","observation_id":"5ca26339-8f0d-4c2c-a364-677c304f767a","resolution":{"observed_at":"2026-08-05T19:01:46.542209Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2311.07919","last_updated":"2023-12-21T10:20:42Z","snapshot_observed_at":"2026-08-07T10:17:55.688598Z","submitted_at":"2023-11-14T05:34:50Z","title":"Qwen-Audio: Advancing Universal Audio Understanding via Unified Large-Scale Audio-Language Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2311.07919","snapshot_observed_at":"2026-08-05T19:01:20.706326Z","title":"Qwen-audio: Advancing universal audio understanding via unified large-scale audio-language models","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2508.14130","last_updated":"2025-08-19T06:58:16Z","snapshot_observed_at":"2026-08-09T19:23:14.500136Z","submitted_at":"2025-08-19T06:58:16Z","title":"EmoSLLM: Parameter-Efficient Adaptation of LLMs for Speech Emotion Recognition","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-05T19:01:20.706326Z"},"links":{"cited_paper":"/paper/2311.07919","citing_paper":"/paper/2508.14130"},"observation_digest":"sha256:8238e1e6c2549d739f353705f2e18f7e11569204df1628fee62e0292421c7432","observation_id":"abb879ae-48a2-4378-9d0a-fec68e32d91f","resolution":{"observed_at":"2026-08-05T19:01:20.706326Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T19:01:20.802087Z","title":"Qwen2-audio technical report, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2508.14130","last_updated":"2025-08-19T06:58:16Z","snapshot_observed_at":"2026-08-09T19:23:14.500136Z","submitted_at":"2025-08-19T06:58:16Z","title":"EmoSLLM: Parameter-Efficient Adaptation of LLMs for Speech Emotion Recognition","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-05T19:01:20.802087Z"},"links":{"citing_paper":"/paper/2508.14130"},"observation_digest":"sha256:df7db9a039c777d117f1da605c9c36287c98125b4b5a0e790605daed672d19b5","observation_id":"0f727b67-fdb9-4467-8cd5-2b7fa2e834b0","resolution":{"observed_at":"2026-08-05T19:01:20.802087Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T19:01:46.506179Z","title":"Chi, Jeff Dean, Jacob Devlin, Adam Roberts, Denny Zhou, Quoc V","venue":null,"work_id":"66a3c04b-efe1-4793-9fb8-05fc3bb68019","year":2022},"citing_paper":{"arxiv_id":"2508.14130","last_updated":"2025-08-19T06:58:16Z","snapshot_observed_at":"2026-08-09T19:23:14.500136Z","submitted_at":"2025-08-19T06:58:16Z","title":"EmoSLLM: Parameter-Efficient Adaptation of LLMs for Speech Emotion Recognition","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-05T19:01:20.878475Z"},"links":{"citing_paper":"/paper/2508.14130"},"observation_digest":"sha256:3acab731e29143193f51815a61736a1bfbddf6fc66f999c5c9aa9877eefe2dd3","observation_id":"40827567-f0a0-4179-97a5-4bd7f71ec114","resolution":{"observed_at":"2026-08-05T19:01:46.513806Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T19:01:46.483878Z","title":"An unsupervised autoregressive model for speech representation learning","venue":null,"work_id":"24d486b0-d27b-4109-b057-46b5f641c9d8","year":2019},"citing_paper":{"arxiv_id":"2508.14130","last_updated":"2025-08-19T06:58:16Z","snapshot_observed_at":"2026-08-09T19:23:14.500136Z","submitted_at":"2025-08-19T06:58:16Z","title":"EmoSLLM: Parameter-Efficient Adaptation of LLMs for Speech Emotion Recognition","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-05T19:01:20.962044Z"},"links":{"citing_paper":"/paper/2508.14130"},"observation_digest":"sha256:a44d646f79fe6d828ef5051769466e79ee4563a9e1fb2a8c7a44ac97d6f8c97f","observation_id":"e03cabcc-4e51-4898-ad1a-9e5652bb2227","resolution":{"observed_at":"2026-08-05T19:01:46.492673Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2405.08295","last_updated":"2025-03-24T21:06:53Z","snapshot_observed_at":"2026-07-06T18:13:55.543513Z","submitted_at":"2024-05-14T03:33:31Z","title":"SpeechVerse: A Large-scale Generalizable Audio Language Model","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2405.08295","snapshot_observed_at":"2026-08-05T19:01:21.059534Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2508.14130","last_updated":"2025-08-19T06:58:16Z","snapshot_observed_at":"2026-08-09T19:23:14.500136Z","submitted_at":"2025-08-19T06:58:16Z","title":"EmoSLLM: Parameter-Efficient Adaptation of LLMs for Speech Emotion Recognition","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-05T19:01:21.059534Z"},"links":{"cited_paper":"/paper/2405.08295","citing_paper":"/paper/2508.14130"},"observation_digest":"sha256:11bec922b0c04f520af44b1aa91fde15f1a368fd7d13ced401e5a3b69585e461","observation_id":"89172613-8aed-4848-822a-cc168751ec30","resolution":{"observed_at":"2026-08-05T19:01:21.059534Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T19:01:46.464718Z","title":"Speech prosody in mental disorders","venue":null,"work_id":"10fc45a5-be57-4703-8e87-d995718fe110","year":2023},"citing_paper":{"arxiv_id":"2508.14130","last_updated":"2025-08-19T06:58:16Z","snapshot_observed_at":"2026-08-09T19:23:14.500136Z","submitted_at":"2025-08-19T06:58:16Z","title":"EmoSLLM: Parameter-Efficient Adaptation of LLMs for Speech Emotion Recognition","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-05T19:01:21.118457Z"},"links":{"citing_paper":"/paper/2508.14130"},"observation_digest":"sha256:b9e372960f56b013179f3e6ab7e86abc38b54e8cf5425ebdb0c559b3a9fa1588","observation_id":"690bd071-bfb0-4438-88bb-ada9aec607a7","resolution":{"observed_at":"2026-08-05T19:01:46.470425Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T19:01:46.447935Z","title":"Learning to predict activity progress by self-supervised video alignment","venue":null,"work_id":"76389d5f-c74b-44f4-875a-c985add3343a","year":2024},"citing_paper":{"arxiv_id":"2508.14130","last_updated":"2025-08-19T06:58:16Z","snapshot_observed_at":"2026-08-09T19:23:14.500136Z","submitted_at":"2025-08-19T06:58:16Z","title":"EmoSLLM: Parameter-Efficient Adaptation of LLMs for Speech Emotion Recognition","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-05T19:01:21.178788Z"},"links":{"citing_paper":"/paper/2508.14130"},"observation_digest":"sha256:bf50155bf53e34d45f04eaa45ef14be43dfd823af128c73d2d6e77c12e7ea7cb","observation_id":"b2404d2a-47a7-4189-b87e-df0042ade9cd","resolution":{"observed_at":"2026-08-05T19:01:46.452637Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T19:01:21.236038Z","title":"Moshi: a speech-text foundation model for real-time dialogue, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2508.14130","last_updated":"2025-08-19T06:58:16Z","snapshot_observed_at":"2026-08-09T19:23:14.500136Z","submitted_at":"2025-08-19T06:58:16Z","title":"EmoSLLM: Parameter-Efficient Adaptation of LLMs for Speech Emotion Recognition","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-05T19:01:21.236038Z"},"links":{"citing_paper":"/paper/2508.14130"},"observation_digest":"sha256:0452227aaa394ad3e49e739f860e7bc84b2000a3c60c5ec6390d07d6a554e568","observation_id":"b2de2793-8150-4a36-919f-6183ccbe3087","resolution":{"observed_at":"2026-08-05T19:01:21.236038Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T19:01:46.413838Z","title":"Prompting large language models with speech recognition abilities","venue":null,"work_id":"8b99042f-0a29-4d07-9706-372a52495105","year":2024},"citing_paper":{"arxiv_id":"2508.14130","last_updated":"2025-08-19T06:58:16Z","snapshot_observed_at":"2026-08-09T19:23:14.500136Z","submitted_at":"2025-08-19T06:58:16Z","title":"EmoSLLM: Parameter-Efficient Adaptation of LLMs for Speech Emotion Recognition","version":1},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-05T19:01:21.297640Z"},"links":{"citing_paper":"/paper/2508.14130"},"observation_digest":"sha256:2e7f13d53bb85dafcc612302460c5b2e9170b8072654e2cd7310da6be2b51949","observation_id":"604d02fc-9a22-482a-b562-95ff874a7276","resolution":{"observed_at":"2026-08-05T19:01:46.420259Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T19:01:46.386845Z","title":"Risk factors for problematic smartphone use in children and adolescents: a review of existing literature","venue":null,"work_id":"57fe91a2-02da-47ea-ba06-2218f7b172e3","year":2019},"citing_paper":{"arxiv_id":"2508.14130","last_updated":"2025-08-19T06:58:16Z","snapshot_observed_at":"2026-08-09T19:23:14.500136Z","submitted_at":"2025-08-19T06:58:16Z","title":"EmoSLLM: Parameter-Efficient Adaptation of LLMs for Speech Emotion Recognition","version":1},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-05T19:01:21.458051Z"},"links":{"citing_paper":"/paper/2508.14130"},"observation_digest":"sha256:695691595d95838d35f488f32ee4184ea2917ce3fe1eb53ac0bcf35e124bfc7a","observation_id":"e8a5b3c1-c32d-46bd-9864-27e6553b1fa3","resolution":{"observed_at":"2026-08-05T19:01:46.395703Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T19:01:46.363159Z","title":"Richemond, Elena Buchatskaya, Carl Doersch, Bernardo Avila Pires, Zhaohan Daniel Guo, Mohammad Gheshlaghi Azar, Bilal Piot, Koray Kavukcuoglu, Rémi Munos, and Michal Valko","venue":null,"work_id":"928bb2b1-02c3-46aa-8800-f65e6ed59556","year":2020},"citing_paper":{"arxiv_id":"2508.14130","last_updated":"2025-08-19T06:58:16Z","snapshot_observed_at":"2026-08-09T19:23:14.500136Z","submitted_at":"2025-08-19T06:58:16Z","title":"EmoSLLM: Parameter-Efficient Adaptation of LLMs for Speech Emotion Recognition","version":1},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-05T19:01:21.583688Z"},"links":{"citing_paper":"/paper/2508.14130"},"observation_digest":"sha256:57951fd8b9955e5e27548fc0b8f3b89ffdd182c7c232939b3144f79581c587e4","observation_id":"b8d10302-99dc-4115-875b-00490fef6635","resolution":{"observed_at":"2026-08-05T19:01:46.370681Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T19:01:46.342578Z","title":"A generalizable speech emotion recognition model reveals depression and remission","venue":null,"work_id":"01ca4145-985e-4063-90e2-5e2b8d7f74e6","year":2022},"citing_paper":{"arxiv_id":"2508.14130","last_updated":"2025-08-19T06:58:16Z","snapshot_observed_at":"2026-08-09T19:23:14.500136Z","submitted_at":"2025-08-19T06:58:16Z","title":"EmoSLLM: Parameter-Efficient Adaptation of LLMs for Speech Emotion Recognition","version":1},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-05T19:01:21.670496Z"},"links":{"citing_paper":"/paper/2508.14130"},"observation_digest":"sha256:06d96023c8aad7dc0f4aeea67f3c33b7af7cec8625d567713ff1086ed03f441c","observation_id":"7ca5f94c-7264-41d4-8213-83f52712fda3","resolution":{"observed_at":"2026-08-05T19:01:46.349010Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T19:01:46.325449Z","title":"Hubert: Self-supervised speech representation learning by masked prediction of hidden units","venue":null,"work_id":"6abe9172-65aa-403c-bc65-1a0e9d3b2867","year":2021},"citing_paper":{"arxiv_id":"2508.14130","last_updated":"2025-08-19T06:58:16Z","snapshot_observed_at":"2026-08-09T19:23:14.500136Z","submitted_at":"2025-08-19T06:58:16Z","title":"EmoSLLM: Parameter-Efficient Adaptation of LLMs for Speech Emotion Recognition","version":1},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-05T19:01:21.773425Z"},"links":{"citing_paper":"/paper/2508.14130"},"observation_digest":"sha256:4167bd344fa882ab0c0f5c8f606c23cbacacf2b049629b1135f800f655d951bd","observation_id":"40c3cf6b-0ca5-4f3d-81ff-5d4bd48da5bc","resolution":{"observed_at":"2026-08-05T19:01:46.330403Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T19:01:46.306864Z","title":"Robust wav2vec 2.0: Analyzing domain shift in self-supervised pre-training","venue":null,"work_id":"a4cd6474-96bd-45a6-87d6-5cf51f01415a","year":2021},"citing_paper":{"arxiv_id":"2508.14130","last_updated":"2025-08-19T06:58:16Z","snapshot_observed_at":"2026-08-09T19:23:14.500136Z","submitted_at":"2025-08-19T06:58:16Z","title":"EmoSLLM: Parameter-Efficient Adaptation of LLMs for Speech Emotion Recognition","version":1},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-08-05T19:01:21.916857Z"},"links":{"citing_paper":"/paper/2508.14130"},"observation_digest":"sha256:d41f69a8043b44fba1f6922e22d1a52d7b69afe6c78fcae34d23d8938bdf41c5","observation_id":"89df3e79-c389-4d1a-9a94-75e64dacc146","resolution":{"observed_at":"2026-08-05T19:01:46.313639Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T19:01:22.032658Z","title":"LoRA: Low-rank adaptation of large language models","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2508.14130","last_updated":"2025-08-19T06:58:16Z","snapshot_observed_at":"2026-08-09T19:23:14.500136Z","submitted_at":"2025-08-19T06:58:16Z","title":"EmoSLLM: Parameter-Efficient Adaptation of LLMs for Speech Emotion Recognition","version":1},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-08-05T19:01:22.032658Z"},"links":{"citing_paper":"/paper/2508.14130"},"observation_digest":"sha256:86171062fe98a472c71300a9e251a59d3c9cd9cffdcd83abc25fde0cc1b89912","observation_id":"936e8dbd-253c-457e-ad9f-4bceef2447f1","resolution":{"observed_at":"2026-08-05T19:01:22.032658Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T19:01:46.277800Z","title":"WavLLM: Towards robust and adaptive speech large language model","venue":null,"work_id":"37d8af0e-7812-4c72-a62d-1e0df269f000","year":2024},"citing_paper":{"arxiv_id":"2508.14130","last_updated":"2025-08-19T06:58:16Z","snapshot_observed_at":"2026-08-09T19:23:14.500136Z","submitted_at":"2025-08-19T06:58:16Z","title":"EmoSLLM: Parameter-Efficient Adaptation of LLMs for Speech Emotion Recognition","version":1},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-08-05T19:01:22.166000Z"},"links":{"citing_paper":"/paper/2508.14130"},"observation_digest":"sha256:272ad0fb4a9b09e69357d3315530006184ce5953cc5244065b8f502b2f7b6069","observation_id":"4213839a-3fe4-4180-a015-443a8249b72d","resolution":{"observed_at":"2026-08-05T19:01:46.283002Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T19:01:46.261197Z","title":"Ibrahim, Antony Perzo, and Simon Leglaive","venue":null,"work_id":"c35037e6-22fd-4437-9063-b0ad70e92b7b","year":2024},"citing_paper":{"arxiv_id":"2508.14130","last_updated":"2025-08-19T06:58:16Z","snapshot_observed_at":"2026-08-09T19:23:14.500136Z","submitted_at":"2025-08-19T06:58:16Z","title":"EmoSLLM: Parameter-Efficient Adaptation of LLMs for Speech Emotion Recognition","version":1},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-08-05T19:01:22.236296Z"},"links":{"citing_paper":"/paper/2508.14130"},"observation_digest":"sha256:31201446631527a60066d3d273aef29312efcc4ee1e703b9f231915b1d51d5b6","observation_id":"39036777-0294-4e66-8fdb-8d1b103a5245","resolution":{"observed_at":"2026-08-05T19:01:46.265753Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T19:01:46.243070Z","title":"Audio flamingo: A novel audio language model with few-shot learning and dialogue abilities","venue":null,"work_id":"1645c841-2cad-403b-a587-a4e28af41494","year":2024},"citing_paper":{"arxiv_id":"2508.14130","last_updated":"2025-08-19T06:58:16Z","snapshot_observed_at":"2026-08-09T19:23:14.500136Z","submitted_at":"2025-08-19T06:58:16Z","title":"EmoSLLM: Parameter-Efficient Adaptation of LLMs for Speech Emotion Recognition","version":1},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-08-05T19:01:22.294637Z"},"links":{"citing_paper":"/paper/2508.14130"},"observation_digest":"sha256:a2d2669977d6732e56655bc18fb36f470f36b5204c060b8d8eb0c6ebb316aa95","observation_id":"79b54156-0e4f-4b5d-b37c-e08c3b7dcce0","resolution":{"observed_at":"2026-08-05T19:01:46.248319Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T19:01:46.223665Z","title":"Masked vision and language modeling for multi-modal representation learning","venue":null,"work_id":"ca986932-526b-48ec-b7cb-921b24995247","year":2023},"citing_paper":{"arxiv_id":"2508.14130","last_updated":"2025-08-19T06:58:16Z","snapshot_observed_at":"2026-08-09T19:23:14.500136Z","submitted_at":"2025-08-19T06:58:16Z","title":"EmoSLLM: Parameter-Efficient Adaptation of LLMs for Speech Emotion Recognition","version":1},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-08-05T19:01:22.327771Z"},"links":{"citing_paper":"/paper/2508.14130"},"observation_digest":"sha256:30cf3a38d287ef242bb39dc0951519a660e11d737f6ed9d4ffc1cf809a8de97d","observation_id":"38d4ede5-7c28-4328-9407-2d32cfab6f3e","resolution":{"observed_at":"2026-08-05T19:01:46.229769Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T19:01:46.202453Z","title":"Modeling caption diversity in contrastive vision-language pretraining","venue":null,"work_id":"ae20a2dc-9ef6-46bb-8063-d07ddb398730","year":2024},"citing_paper":{"arxiv_id":"2508.14130","last_updated":"2025-08-19T06:58:16Z","snapshot_observed_at":"2026-08-09T19:23:14.500136Z","submitted_at":"2025-08-19T06:58:16Z","title":"EmoSLLM: Parameter-Efficient Adaptation of LLMs for Speech Emotion Recognition","version":1},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-08-05T19:01:22.418248Z"},"links":{"citing_paper":"/paper/2508.14130"},"observation_digest":"sha256:4d149d6cf6c16b3296b55f1b4fe0d9f86331afbc60bc3abd8079c6090f273b20","observation_id":"c49c21c6-75a1-4f0b-ac02-5ab1ca196f22","resolution":{"observed_at":"2026-08-05T19:01:46.209139Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T19:01:46.181371Z","title":"Binning as a pretext task: Improving self-supervised learning in tabular domains","venue":null,"work_id":"fe263485-0f09-4a42-ba66-6722798e800a","year":2024},"citing_paper":{"arxiv_id":"2508.14130","last_updated":"2025-08-19T06:58:16Z","snapshot_observed_at":"2026-08-09T19:23:14.500136Z","submitted_at":"2025-08-19T06:58:16Z","title":"EmoSLLM: Parameter-Efficient Adaptation of LLMs for Speech Emotion Recognition","version":1},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-08-05T19:01:22.491884Z"},"links":{"citing_paper":"/paper/2508.14130"},"observation_digest":"sha256:69d0e0bded58c190c475bbefb38e92d3790870d84fc022ceacb0b82aa1c5e09b","observation_id":"ecc48aa8-cef9-49b8-a540-2fd99399f896","resolution":{"observed_at":"2026-08-05T19:01:46.188186Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T19:01:22.549102Z","title":"Blip-2: bootstrapping language-image pre-training with frozen image encoders and large language models","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2508.14130","last_updated":"2025-08-19T06:58:16Z","snapshot_observed_at":"2026-08-09T19:23:14.500136Z","submitted_at":"2025-08-19T06:58:16Z","title":"EmoSLLM: Parameter-Efficient Adaptation of LLMs for Speech Emotion Recognition","version":1},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-08-05T19:01:22.549102Z"},"links":{"citing_paper":"/paper/2508.14130"},"observation_digest":"sha256:f4477aa9020a0e13e0297c8ce04959e8858d52406b0b84281e718fb6ad7b85d4","observation_id":"26c43586-b09a-4a0c-9709-fb9fa2167edf","resolution":{"observed_at":"2026-08-05T19:01:22.549102Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T19:01:46.142140Z","title":"Revise, reason, and recognize: Llm-based emotion recognition via emotion-specific prompts and asr error correction","venue":null,"work_id":"4e0e0e32-33ff-4e00-8077-b648d59b436c","year":2025},"citing_paper":{"arxiv_id":"2508.14130","last_updated":"2025-08-19T06:58:16Z","snapshot_observed_at":"2026-08-09T19:23:14.500136Z","submitted_at":"2025-08-19T06:58:16Z","title":"EmoSLLM: Parameter-Efficient Adaptation of LLMs for Speech Emotion Recognition","version":1},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-08-05T19:01:22.610013Z"},"links":{"citing_paper":"/paper/2508.14130"},"observation_digest":"sha256:9692a28f635741eb2dec1bbfa8e097f958b07054afe80ad47355a2f3471cd329","observation_id":"14095ca2-d63e-43dc-95e7-430077254b37","resolution":{"observed_at":"2026-08-05T19:01:46.148362Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T19:01:46.123066Z","title":"Liu, Yu-An Chung, and James R","venue":null,"work_id":"f27eae25-2905-42f6-8815-b382327359e9","year":2020},"citing_paper":{"arxiv_id":"2508.14130","last_updated":"2025-08-19T06:58:16Z","snapshot_observed_at":"2026-08-09T19:23:14.500136Z","submitted_at":"2025-08-19T06:58:16Z","title":"EmoSLLM: Parameter-Efficient Adaptation of LLMs for Speech Emotion Recognition","version":1},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-08-05T19:01:22.657713Z"},"links":{"citing_paper":"/paper/2508.14130"},"observation_digest":"sha256:2ec1a3fb6de19dc09d44f8bf8dbc8cd2d8ed8eefe1d26b9740938049ba246271","observation_id":"057f500a-a6d8-4ba3-ad0c-d7029a3a581b","resolution":{"observed_at":"2026-08-05T19:01:46.128203Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T19:01:46.104254Z","title":"Liu, Shang-Wen Li, and Hung yi Lee","venue":null,"work_id":"28f62755-c0f3-4a3c-9716-2ead661d3ffd","year":2020},"citing_paper":{"arxiv_id":"2508.14130","last_updated":"2025-08-19T06:58:16Z","snapshot_observed_at":"2026-08-09T19:23:14.500136Z","submitted_at":"2025-08-19T06:58:16Z","title":"EmoSLLM: Parameter-Efficient Adaptation of LLMs for Speech Emotion Recognition","version":1},"reference_index":36,"source":"pdf_text","source_observed_at":"2026-08-05T19:01:22.720352Z"},"links":{"citing_paper":"/paper/2508.14130"},"observation_digest":"sha256:748b513de4e090e8de964fa3a504778d0db9eca04f2b1449c783b2f7e8e6ab1f","observation_id":"1dcec125-d867-409a-bf03-11333f56b31e","resolution":{"observed_at":"2026-08-05T19:01:46.109729Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T19:01:22.792704Z","title":"Decoupled weight decay regularization","venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2508.14130","last_updated":"2025-08-19T06:58:16Z","snapshot_observed_at":"2026-08-09T19:23:14.500136Z","submitted_at":"2025-08-19T06:58:16Z","title":"EmoSLLM: Parameter-Efficient Adaptation of LLMs for Speech Emotion Recognition","version":1},"reference_index":37,"source":"pdf_text","source_observed_at":"2026-08-05T19:01:22.792704Z"},"links":{"citing_paper":"/paper/2508.14130"},"observation_digest":"sha256:92d34fd124f2e43a5d3efdb1a6954b866916a07ef8a8bd5b9c39b1ed23a22275","observation_id":"6f306275-d1e2-4902-b8eb-fcfa73a28bfa","resolution":{"observed_at":"2026-08-05T19:01:22.792704Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T19:01:46.065831Z","title":"Building naturalistic emotionally balanced speech corpus by retrieving emotional speech from existing podcast recordings","venue":null,"work_id":"f7356865-703a-411f-b69d-726cdfafbdf7","year":2019},"citing_paper":{"arxiv_id":"2508.14130","last_updated":"2025-08-19T06:58:16Z","snapshot_observed_at":"2026-08-09T19:23:14.500136Z","submitted_at":"2025-08-19T06:58:16Z","title":"EmoSLLM: Parameter-Efficient Adaptation of LLMs for Speech Emotion Recognition","version":1},"reference_index":38,"source":"pdf_text","source_observed_at":"2026-08-05T19:01:22.858025Z"},"links":{"citing_paper":"/paper/2508.14130"},"observation_digest":"sha256:644e3065a993947de19ccdc3d6cfe144c35923ae742c6125a8345a769862560f","observation_id":"fa4c8014-235e-4332-95b9-0f46aaab0837","resolution":{"observed_at":"2026-08-05T19:01:46.072566Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T19:01:46.045715Z","title":"The llama 3 herd of models, 2024","venue":null,"work_id":"eb00038f-f469-4903-821b-c1bfe3ffa3a3","year":2024},"citing_paper":{"arxiv_id":"2508.14130","last_updated":"2025-08-19T06:58:16Z","snapshot_observed_at":"2026-08-09T19:23:14.500136Z","submitted_at":"2025-08-19T06:58:16Z","title":"EmoSLLM: Parameter-Efficient Adaptation of LLMs for Speech Emotion Recognition","version":1},"reference_index":39,"source":"pdf_text","source_observed_at":"2026-08-05T19:01:22.900565Z"},"links":{"citing_paper":"/paper/2508.14130"},"observation_digest":"sha256:ba341f7db27303afe1399c248e7d226507d48cffe9c93537243cf8a07386c3b1","observation_id":"7768da0b-c871-47cf-a1ef-50a7026b794f","resolution":{"observed_at":"2026-08-05T19:01:46.052217Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T19:01:45.993508Z","title":"Byol for audio: Self-supervised learning for general-purpose audio representation","venue":null,"work_id":"270dcdad-494d-4faa-854e-7e13d014a885","year":2021},"citing_paper":{"arxiv_id":"2508.14130","last_updated":"2025-08-19T06:58:16Z","snapshot_observed_at":"2026-08-09T19:23:14.500136Z","submitted_at":"2025-08-19T06:58:16Z","title":"EmoSLLM: Parameter-Efficient Adaptation of LLMs for Speech Emotion Recognition","version":1},"reference_index":40,"source":"pdf_text","source_observed_at":"2026-08-05T19:01:22.963271Z"},"links":{"citing_paper":"/paper/2508.14130"},"observation_digest":"sha256:fd0d38e2d3cff512a6cfb6999949c4b2e58c9d484302589c759d4663f18f64a5","observation_id":"84332ff0-aa25-47d0-8217-5e72e28142b6","resolution":{"observed_at":"2026-08-05T19:01:46.033339Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T19:01:45.768404Z","title":"Byol for audio: Exploring pre-trained general-purpose audio representations","venue":null,"work_id":"513bfd5f-abec-42e5-81c6-a31acb11c898","year":2023},"citing_paper":{"arxiv_id":"2508.14130","last_updated":"2025-08-19T06:58:16Z","snapshot_observed_at":"2026-08-09T19:23:14.500136Z","submitted_at":"2025-08-19T06:58:16Z","title":"EmoSLLM: Parameter-Efficient Adaptation of LLMs for Speech Emotion Recognition","version":1},"reference_index":41,"source":"pdf_text","source_observed_at":"2026-08-05T19:01:23.026570Z"},"links":{"citing_paper":"/paper/2508.14130"},"observation_digest":"sha256:8dc7995807b0c114a7b86fb6922a8ffa72aaeb77d8b3061657a86a8a01ab039f","observation_id":"652bda04-7608-4b0e-95af-1bbc0902a1a7","resolution":{"observed_at":"2026-08-05T19:01:45.941970Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T19:01:45.621828Z","title":"Olson, Dasha A","venue":null,"work_id":"49edd63d-4243-427e-81d7-a0f5de1e641e","year":2022},"citing_paper":{"arxiv_id":"2508.14130","last_updated":"2025-08-19T06:58:16Z","snapshot_observed_at":"2026-08-09T19:23:14.500136Z","submitted_at":"2025-08-19T06:58:16Z","title":"EmoSLLM: Parameter-Efficient Adaptation of LLMs for Speech Emotion Recognition","version":1},"reference_index":42,"source":"pdf_text","source_observed_at":"2026-08-05T19:01:23.099129Z"},"links":{"citing_paper":"/paper/2508.14130"},"observation_digest":"sha256:42bb7c83cac4e3671a5c9dda4915681b88f79b496edd358ed97bda92c14b95d5","observation_id":"d4a3ba5a-17db-4167-934f-b11140853003","resolution":{"observed_at":"2026-08-05T19:01:45.721655Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T19:01:23.138521Z","title":"Librispeech: An asr corpus based on public domain audio books","venue":null,"work_id":null,"year":2015},"citing_paper":{"arxiv_id":"2508.14130","last_updated":"2025-08-19T06:58:16Z","snapshot_observed_at":"2026-08-09T19:23:14.500136Z","submitted_at":"2025-08-19T06:58:16Z","title":"EmoSLLM: Parameter-Efficient Adaptation of LLMs for Speech Emotion Recognition","version":1},"reference_index":43,"source":"pdf_text","source_observed_at":"2026-08-05T19:01:23.138521Z"},"links":{"citing_paper":"/paper/2508.14130"},"observation_digest":"sha256:4e717d6868e3f9567ee7a30a2923f711b787010916ff8d037093af4844d154e4","observation_id":"b65bf25c-dc21-4d93-ad29-8a21e08c1199","resolution":{"observed_at":"2026-08-05T19:01:23.138521Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T19:01:45.326233Z","title":"Strimel, and Andreas Schwarz","venue":null,"work_id":"1220460f-64c9-40cf-9b18-c468b71170fd","year":2025},"citing_paper":{"arxiv_id":"2508.14130","last_updated":"2025-08-19T06:58:16Z","snapshot_observed_at":"2026-08-09T19:23:14.500136Z","submitted_at":"2025-08-19T06:58:16Z","title":"EmoSLLM: Parameter-Efficient Adaptation of LLMs for Speech Emotion Recognition","version":1},"reference_index":44,"source":"pdf_text","source_observed_at":"2026-08-05T19:01:23.178378Z"},"links":{"citing_paper":"/paper/2508.14130"},"observation_digest":"sha256:4c7645becb91d8086843b4e3922d1992f556d4ca176fd8865da745bad399f2b7","observation_id":"faaf7ce7-4e2f-4b16-b32c-fe0831262366","resolution":{"observed_at":"2026-08-05T19:01:45.441316Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T19:01:45.084265Z","title":"Emotion Recognition from Speech Using wav2vec 2.0 Embeddings","venue":null,"work_id":"48dbccf2-80b2-4412-a504-8190cef91a7b","year":2021},"citing_paper":{"arxiv_id":"2508.14130","last_updated":"2025-08-19T06:58:16Z","snapshot_observed_at":"2026-08-09T19:23:14.500136Z","submitted_at":"2025-08-19T06:58:16Z","title":"EmoSLLM: Parameter-Efficient Adaptation of LLMs for Speech Emotion Recognition","version":1},"reference_index":45,"source":"pdf_text","source_observed_at":"2026-08-05T19:01:23.226362Z"},"links":{"citing_paper":"/paper/2508.14130"},"observation_digest":"sha256:2325ad78a36c63c5e83f34e881a077e4460dfd8e62f31d92de977552d33b4cd5","observation_id":"9fcfa147-358a-44e1-8512-e0f4e57b4a00","resolution":{"observed_at":"2026-08-05T19:01:45.190947Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T19:01:44.848287Z","title":"V oice modulation: A window into the origins of human vocal control? Trends in Cognitive Sciences, 20(4):304–318, 2016","venue":null,"work_id":"da4e63ac-3f4f-41a1-8344-2b8721dba757","year":2016},"citing_paper":{"arxiv_id":"2508.14130","last_updated":"2025-08-19T06:58:16Z","snapshot_observed_at":"2026-08-09T19:23:14.500136Z","submitted_at":"2025-08-19T06:58:16Z","title":"EmoSLLM: Parameter-Efficient Adaptation of LLMs for Speech Emotion Recognition","version":1},"reference_index":46,"source":"pdf_text","source_observed_at":"2026-08-05T19:01:23.320516Z"},"links":{"citing_paper":"/paper/2508.14130"},"observation_digest":"sha256:d93e75607021e4b759852dde2482980e6281c17709cc51f4e30712e0b3797092","observation_id":"d65b04ca-57f1-4c6d-a2b1-0117ede1df2f","resolution":{"observed_at":"2026-08-05T19:01:44.962829Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T19:01:23.392952Z","title":"Qwen2.5 technical report, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2508.14130","last_updated":"2025-08-19T06:58:16Z","snapshot_observed_at":"2026-08-09T19:23:14.500136Z","submitted_at":"2025-08-19T06:58:16Z","title":"EmoSLLM: Parameter-Efficient Adaptation of LLMs for Speech Emotion Recognition","version":1},"reference_index":47,"source":"pdf_text","source_observed_at":"2026-08-05T19:01:23.392952Z"},"links":{"citing_paper":"/paper/2508.14130"},"observation_digest":"sha256:4e6f5372f7fcd04124ef8ea1a71b7d93db618e530fd49388a2e70c1ca7097751","observation_id":"ae6ae9af-902b-45a5-aed8-eee93c463da4","resolution":{"observed_at":"2026-08-05T19:01:23.392952Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T19:01:44.543029Z","title":"Learning transferable visual models from natural language supervision","venue":null,"work_id":"0974466a-0546-4cfd-87c6-03089f233c70","year":2021},"citing_paper":{"arxiv_id":"2508.14130","last_updated":"2025-08-19T06:58:16Z","snapshot_observed_at":"2026-08-09T19:23:14.500136Z","submitted_at":"2025-08-19T06:58:16Z","title":"EmoSLLM: Parameter-Efficient Adaptation of LLMs for Speech Emotion Recognition","version":1},"reference_index":48,"source":"pdf_text","source_observed_at":"2026-08-05T19:01:23.453725Z"},"links":{"citing_paper":"/paper/2508.14130"},"observation_digest":"sha256:ae52f28852e9a9c4455ef38bbf3c6022d8c91f25d4b5dee7444fd99eeb90d5fc","observation_id":"be217bed-d5a8-49d7-a7ae-ad151ec2fa41","resolution":{"observed_at":"2026-08-05T19:01:44.666612Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T19:01:44.296704Z","title":"Robust speech recognition via large-scale weak supervision","venue":null,"work_id":"0a053b18-f5e5-48ca-b6f2-9a0474e987b7","year":2023},"citing_paper":{"arxiv_id":"2508.14130","last_updated":"2025-08-19T06:58:16Z","snapshot_observed_at":"2026-08-09T19:23:14.500136Z","submitted_at":"2025-08-19T06:58:16Z","title":"EmoSLLM: Parameter-Efficient Adaptation of LLMs for Speech Emotion Recognition","version":1},"reference_index":49,"source":"pdf_text","source_observed_at":"2026-08-05T19:01:23.494518Z"},"links":{"citing_paper":"/paper/2508.14130"},"observation_digest":"sha256:bb783c0cfa9919a987f0cce24f0b8be487428e8c5a25a5266d679696c509a3df","observation_id":"4260065f-cb11-48f9-899c-091ba0206297","resolution":{"observed_at":"2026-08-05T19:01:44.405983Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T19:01:44.002186Z","title":"Generating diverse high-fidelity images with vq-vae-2","venue":null,"work_id":"cd0a879f-40dc-4b76-98b5-5390cb028921","year":2019},"citing_paper":{"arxiv_id":"2508.14130","last_updated":"2025-08-19T06:58:16Z","snapshot_observed_at":"2026-08-09T19:23:14.500136Z","submitted_at":"2025-08-19T06:58:16Z","title":"EmoSLLM: Parameter-Efficient Adaptation of LLMs for Speech Emotion Recognition","version":1},"reference_index":50,"source":"pdf_text","source_observed_at":"2026-08-05T19:01:23.569936Z"},"links":{"citing_paper":"/paper/2508.14130"},"observation_digest":"sha256:28bee65ae44822764b2de9b5ad5b805f280844434ab6abea334444a944f12892","observation_id":"a97c329d-bf9f-48bb-b580-8e5e3ed94722","resolution":{"observed_at":"2026-08-05T19:01:44.116729Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1904.05862","last_updated":"2019-09-11T08:19:49Z","snapshot_observed_at":"2026-08-06T05:33:37.746688Z","submitted_at":"2019-04-11T17:29:30Z","title":"wav2vec: Unsupervised Pre-training for Speech Recognition","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1904.05862","snapshot_observed_at":"2026-08-05T19:01:23.671306Z","title":"wav2vec: Unsupervised pre-training for speech recognition","venue":null,"work_id":null,"year":1904},"citing_paper":{"arxiv_id":"2508.14130","last_updated":"2025-08-19T06:58:16Z","snapshot_observed_at":"2026-08-09T19:23:14.500136Z","submitted_at":"2025-08-19T06:58:16Z","title":"EmoSLLM: Parameter-Efficient Adaptation of LLMs for Speech Emotion Recognition","version":1},"reference_index":51,"source":"pdf_text","source_observed_at":"2026-08-05T19:01:23.671306Z"},"links":{"cited_paper":"/paper/1904.05862","citing_paper":"/paper/2508.14130"},"observation_digest":"sha256:8655bdbdc0be2fa4c8dd7c537f189fc274e8b711d244482d8f8409d14cc0820f","observation_id":"7f0dfb18-be61-48e4-a07e-b129e4107d22","resolution":{"observed_at":"2026-08-05T19:01:23.671306Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T19:01:43.906973Z","title":"Flava: A foundational language and vision alignment model","venue":null,"work_id":"466c5450-b8af-4397-bec6-d47bf5908f1e","year":2022},"citing_paper":{"arxiv_id":"2508.14130","last_updated":"2025-08-19T06:58:16Z","snapshot_observed_at":"2026-08-09T19:23:14.500136Z","submitted_at":"2025-08-19T06:58:16Z","title":"EmoSLLM: Parameter-Efficient Adaptation of LLMs for Speech Emotion Recognition","version":1},"reference_index":52,"source":"pdf_text","source_observed_at":"2026-08-05T19:01:23.742668Z"},"links":{"citing_paper":"/paper/2508.14130"},"observation_digest":"sha256:f0158676449c7d76660e46e2536598931cf7251370430e5551d3a5c48dc2f1d4","observation_id":"a0f11967-843b-4a54-b1c4-7cb694f85153","resolution":{"observed_at":"2026-08-05T19:01:43.956446Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T19:01:43.770224Z","title":"SALMONN: Towards generic hearing abilities for large language models","venue":null,"work_id":"80a77cbd-3ace-407e-a538-a1510b7efab0","year":2024},"citing_paper":{"arxiv_id":"2508.14130","last_updated":"2025-08-19T06:58:16Z","snapshot_observed_at":"2026-08-09T19:23:14.500136Z","submitted_at":"2025-08-19T06:58:16Z","title":"EmoSLLM: Parameter-Efficient Adaptation of LLMs for Speech Emotion Recognition","version":1},"reference_index":53,"source":"pdf_text","source_observed_at":"2026-08-05T19:01:23.786403Z"},"links":{"citing_paper":"/paper/2508.14130"},"observation_digest":"sha256:ca19c8fce58c20b80d0187d2c94685afb3137c9fd3640825bb525173d0c051f9","observation_id":"f967e566-c2ed-4242-9ce3-21ad008c08ae","resolution":{"observed_at":"2026-08-05T19:01:43.813149Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T19:01:23.825644Z","title":"Chameleon: Mixed-modal early-fusion foundation models, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2508.14130","last_updated":"2025-08-19T06:58:16Z","snapshot_observed_at":"2026-08-09T19:23:14.500136Z","submitted_at":"2025-08-19T06:58:16Z","title":"EmoSLLM: Parameter-Efficient Adaptation of LLMs for Speech Emotion Recognition","version":1},"reference_index":54,"source":"pdf_text","source_observed_at":"2026-08-05T19:01:23.825644Z"},"links":{"citing_paper":"/paper/2508.14130"},"observation_digest":"sha256:a99682b6ce9a91fa69e2ba9f368966075ad89f9bf587acc693ece85b2d3f558e","observation_id":"4dc53a46-6f11-4622-bed8-3768cedebb69","resolution":{"observed_at":"2026-08-05T19:01:23.825644Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T19:01:43.649544Z","title":"T-JEPA: Augmentation-free self-supervised learning for tabular data","venue":null,"work_id":"37bba3d4-92e3-4e9f-82db-c06d42ce74d3","year":2025},"citing_paper":{"arxiv_id":"2508.14130","last_updated":"2025-08-19T06:58:16Z","snapshot_observed_at":"2026-08-09T19:23:14.500136Z","submitted_at":"2025-08-19T06:58:16Z","title":"EmoSLLM: Parameter-Efficient Adaptation of LLMs for Speech Emotion Recognition","version":1},"reference_index":55,"source":"pdf_text","source_observed_at":"2026-08-05T19:01:23.870260Z"},"links":{"citing_paper":"/paper/2508.14130"},"observation_digest":"sha256:d5bf687cbe94daee7d8b20a458398ad8abdc90f3137fce06334ae5f4f70e2be8","observation_id":"756f964c-ce41-4c4a-a19d-bfe7322083f4","resolution":{"observed_at":"2026-08-05T19:01:43.702511Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T19:01:43.501772Z","title":null,"venue":null,"work_id":"71befe51-7890-4dd3-b453-0f38cee2a27c","year":2021},"citing_paper":{"arxiv_id":"2508.14130","last_updated":"2025-08-19T06:58:16Z","snapshot_observed_at":"2026-08-09T19:23:14.500136Z","submitted_at":"2025-08-19T06:58:16Z","title":"EmoSLLM: Parameter-Efficient Adaptation of LLMs for Speech Emotion Recognition","version":1},"reference_index":56,"source":"pdf_text","source_observed_at":"2026-08-05T19:01:23.926872Z"},"links":{"citing_paper":"/paper/2508.14130"},"observation_digest":"sha256:cac8c40344f31eec9b30f4ea9dba5a20b6d794f827a2d5cf47bce9394b16ded0","observation_id":"fa718704-5668-4f85-990e-c9ff4e21fff0","resolution":{"observed_at":"2026-08-05T19:01:43.570579Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T19:01:43.336833Z","title":"Improved baselines for data-efficient perceptual augmentation of LLMs, 2024","venue":null,"work_id":"141f118b-6f1c-49fc-9a04-f2650d73f886","year":2024},"citing_paper":{"arxiv_id":"2508.14130","last_updated":"2025-08-19T06:58:16Z","snapshot_observed_at":"2026-08-09T19:23:14.500136Z","submitted_at":"2025-08-19T06:58:16Z","title":"EmoSLLM: Parameter-Efficient Adaptation of LLMs for Speech Emotion Recognition","version":1},"reference_index":57,"source":"pdf_text","source_observed_at":"2026-08-05T19:01:24.004589Z"},"links":{"citing_paper":"/paper/2508.14130"},"observation_digest":"sha256:9fcacb602211eaf1e37800ad7889beee7ff2ae7f1fba3d3fc8d670f0ba4d80b7","observation_id":"4b65a974-fb17-4c12-a888-238c189946e4","resolution":{"observed_at":"2026-08-05T19:01:43.405953Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T19:01:43.152595Z","title":"Neural discrete representation learning","venue":null,"work_id":"39daa84c-ed11-4335-ac30-482594f71ff5","year":2017},"citing_paper":{"arxiv_id":"2508.14130","last_updated":"2025-08-19T06:58:16Z","snapshot_observed_at":"2026-08-09T19:23:14.500136Z","submitted_at":"2025-08-19T06:58:16Z","title":"EmoSLLM: Parameter-Efficient Adaptation of LLMs for Speech Emotion Recognition","version":1},"reference_index":58,"source":"pdf_text","source_observed_at":"2026-08-05T19:01:24.086829Z"},"links":{"citing_paper":"/paper/2508.14130"},"observation_digest":"sha256:03a4dac30ed24ceba18cb109322b7cb3f9974e2dc2417997382fa6801a0b46ea","observation_id":"3d5188bb-92b2-44e0-8bf8-57865b360f16","resolution":{"observed_at":"2026-08-05T19:01:43.238606Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T19:01:42.988432Z","title":"Schuller","venue":null,"work_id":"3828e0e8-94dd-4184-8468-4c68adfc8642","year":2023},"citing_paper":{"arxiv_id":"2508.14130","last_updated":"2025-08-19T06:58:16Z","snapshot_observed_at":"2026-08-09T19:23:14.500136Z","submitted_at":"2025-08-19T06:58:16Z","title":"EmoSLLM: Parameter-Efficient Adaptation of LLMs for Speech Emotion Recognition","version":1},"reference_index":59,"source":"pdf_text","source_observed_at":"2026-08-05T19:01:24.130131Z"},"links":{"citing_paper":"/paper/2508.14130"},"observation_digest":"sha256:ec5340d7fca7da2e9dfcdc3b1d553c09b47c12463eb8d8ebcbc2cb6fc84b3d33","observation_id":"befbdacb-0845-4b22-8b62-5238da51bc28","resolution":{"observed_at":"2026-08-05T19:01:43.053250Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2111.02735","last_updated":"2022-10-03T20:50:54Z","snapshot_observed_at":"2026-07-06T12:05:22.076764Z","submitted_at":"2021-11-04T10:39:06Z","title":"A Fine-tuned Wav2vec 2.0/HuBERT Benchmark For Speech Emotion Recognition, Speaker Verification and Spoken Language Understanding","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2111.02735","snapshot_observed_at":"2026-08-05T19:01:24.191393Z","title":"A fine-tuned wav2vec 2.0/hubert benchmark for speech emotion recognition, speaker verification and spoken language understanding","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2508.14130","last_updated":"2025-08-19T06:58:16Z","snapshot_observed_at":"2026-08-09T19:23:14.500136Z","submitted_at":"2025-08-19T06:58:16Z","title":"EmoSLLM: Parameter-Efficient Adaptation of LLMs for Speech Emotion Recognition","version":1},"reference_index":60,"source":"pdf_text","source_observed_at":"2026-08-05T19:01:24.191393Z"},"links":{"cited_paper":"/paper/2111.02735","citing_paper":"/paper/2508.14130"},"observation_digest":"sha256:44b8fd17d8ea8eb5bea6e662781e97d8bd082be1c28210cb2ae90effc0f55df9","observation_id":"e093735d-c928-47c2-a74d-e3511988e94b","resolution":{"observed_at":"2026-08-05T19:01:24.191393Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T19:01:42.849207Z","title":"Towards latent masked image modeling for self-supervised visual representation learning","venue":null,"work_id":"8c2afccd-3268-4dd0-8f23-fa455fe51db0","year":2024},"citing_paper":{"arxiv_id":"2508.14130","last_updated":"2025-08-19T06:58:16Z","snapshot_observed_at":"2026-08-09T19:23:14.500136Z","submitted_at":"2025-08-19T06:58:16Z","title":"EmoSLLM: Parameter-Efficient Adaptation of LLMs for Speech Emotion Recognition","version":1},"reference_index":61,"source":"pdf_text","source_observed_at":"2026-08-05T19:01:24.280553Z"},"links":{"citing_paper":"/paper/2508.14130"},"observation_digest":"sha256:ffb68088783d1be4749b5add8f864fe0c3602638c092fa65829ba346e2165037","observation_id":"1f672392-9f67-4e8e-876e-be60fc74d23a","resolution":{"observed_at":"2026-08-05T19:01:42.916560Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T19:01:42.672069Z","title":"On decoder-only architecture for speech-to-text and large language model integration, 2023","venue":null,"work_id":"c6f23481-98f6-4de6-853c-1341ac5cff2f","year":2023},"citing_paper":{"arxiv_id":"2508.14130","last_updated":"2025-08-19T06:58:16Z","snapshot_observed_at":"2026-08-09T19:23:14.500136Z","submitted_at":"2025-08-19T06:58:16Z","title":"EmoSLLM: Parameter-Efficient Adaptation of LLMs for Speech Emotion Recognition","version":1},"reference_index":62,"source":"pdf_text","source_observed_at":"2026-08-05T19:01:24.344446Z"},"links":{"citing_paper":"/paper/2508.14130"},"observation_digest":"sha256:4018d648f9fd61fc814550d43ca3c55a27772ad118b7d3429f3dd773bd89bfc6","observation_id":"993294aa-cb5b-4a93-a125-70f9f0950cf5","resolution":{"observed_at":"2026-08-05T19:01:42.747469Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T19:01:42.499709Z","title":"Switchtab: Switched autoencoders are effective tabular learners","venue":null,"work_id":"779cd382-8ebf-46da-9f27-d7d7ab6c6bc2","year":2024},"citing_paper":{"arxiv_id":"2508.14130","last_updated":"2025-08-19T06:58:16Z","snapshot_observed_at":"2026-08-09T19:23:14.500136Z","submitted_at":"2025-08-19T06:58:16Z","title":"EmoSLLM: Parameter-Efficient Adaptation of LLMs for Speech Emotion Recognition","version":1},"reference_index":63,"source":"pdf_text","source_observed_at":"2026-08-05T19:01:24.372433Z"},"links":{"citing_paper":"/paper/2508.14130"},"observation_digest":"sha256:c869cbe229d27128581d652d228e771294c1135cca06ea35cb990dfde525e64e","observation_id":"269d79d5-751b-4afd-8961-346dcc2f7e35","resolution":{"observed_at":"2026-08-05T19:01:42.571055Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2505.09388","last_updated":"2025-05-14T13:41:34Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-05-14T13:41:34Z","title":"Qwen3 Technical Report","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2505.09388","snapshot_observed_at":"2026-08-05T19:01:24.436973Z","title":"Qwen3 technical report","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2508.14130","last_updated":"2025-08-19T06:58:16Z","snapshot_observed_at":"2026-08-09T19:23:14.500136Z","submitted_at":"2025-08-19T06:58:16Z","title":"EmoSLLM: Parameter-Efficient Adaptation of LLMs for Speech Emotion Recognition","version":1},"reference_index":64,"source":"pdf_text","source_observed_at":"2026-08-05T19:01:24.436973Z"},"links":{"cited_paper":"/paper/2505.09388","citing_paper":"/paper/2508.14130"},"observation_digest":"sha256:bc8480602ba448a4dbf0f5e2f5c6959dfc56416f5969ffef571115492620fc17","observation_id":"713a01ad-c6fe-44ff-89ee-b57d89fd35da","resolution":{"observed_at":"2026-08-05T19:01:24.436973Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T19:01:42.359163Z","title":"Detection of mood disorder using speech emotion profiles and lstm","venue":null,"work_id":"d180d556-120a-4e8f-9015-b7a1146cbe80","year":2016},"citing_paper":{"arxiv_id":"2508.14130","last_updated":"2025-08-19T06:58:16Z","snapshot_observed_at":"2026-08-09T19:23:14.500136Z","submitted_at":"2025-08-19T06:58:16Z","title":"EmoSLLM: Parameter-Efficient Adaptation of LLMs for Speech Emotion Recognition","version":1},"reference_index":65,"source":"pdf_text","source_observed_at":"2026-08-05T19:01:24.497700Z"},"links":{"citing_paper":"/paper/2508.14130"},"observation_digest":"sha256:4768cd134e680ed6da617bc287c707bbd5abdcca47379429df0bef3a3821de7e","observation_id":"429e1704-9c86-4f1f-8775-020160c7d55e","resolution":{"observed_at":"2026-08-05T19:01:42.426558Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T19:01:42.111045Z","title":"Coca: Contrastive captioners are image-text foundation models","venue":null,"work_id":"ad388093-a730-4e36-bbeb-d686c8f531ac","year":2022},"citing_paper":{"arxiv_id":"2508.14130","last_updated":"2025-08-19T06:58:16Z","snapshot_observed_at":"2026-08-09T19:23:14.500136Z","submitted_at":"2025-08-19T06:58:16Z","title":"EmoSLLM: Parameter-Efficient Adaptation of LLMs for Speech Emotion Recognition","version":1},"reference_index":66,"source":"pdf_text","source_observed_at":"2026-08-05T19:01:24.566366Z"},"links":{"citing_paper":"/paper/2508.14130"},"observation_digest":"sha256:b6716e7123e46b5b6e1df390a43442f7aeffe067c81b5eabddc90cfdfcf728bf","observation_id":"fcdb43d8-40d4-4b00-bc94-aa549ac2d188","resolution":{"observed_at":"2026-08-05T19:01:42.242393Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T19:01:41.970339Z","title":"Connecting speech encoder and large language model for asr","venue":null,"work_id":"34833bed-0af3-4a96-96c4-b2692f199954","year":2024},"citing_paper":{"arxiv_id":"2508.14130","last_updated":"2025-08-19T06:58:16Z","snapshot_observed_at":"2026-08-09T19:23:14.500136Z","submitted_at":"2025-08-19T06:58:16Z","title":"EmoSLLM: Parameter-Efficient Adaptation of LLMs for Speech Emotion Recognition","version":1},"reference_index":67,"source":"pdf_text","source_observed_at":"2026-08-05T19:01:24.645692Z"},"links":{"citing_paper":"/paper/2508.14130"},"observation_digest":"sha256:8e88ed3ee64df392f564ee9ff4eda00bb769b80cacd6bb3fcc9ba18f1f6dfc3f","observation_id":"e9c94ed4-59cc-45e3-9adb-876839345ba7","resolution":{"observed_at":"2026-08-05T19:01:42.042815Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T19:01:41.741710Z","title":"Barlow twins: Self- supervised learning via redundancy reduction","venue":null,"work_id":"9892dbb6-1a74-4eb8-a2a3-931477913686","year":2021},"citing_paper":{"arxiv_id":"2508.14130","last_updated":"2025-08-19T06:58:16Z","snapshot_observed_at":"2026-08-09T19:23:14.500136Z","submitted_at":"2025-08-19T06:58:16Z","title":"EmoSLLM: Parameter-Efficient Adaptation of LLMs for Speech Emotion Recognition","version":1},"reference_index":68,"source":"pdf_text","source_observed_at":"2026-08-05T19:01:24.704777Z"},"links":{"citing_paper":"/paper/2508.14130"},"observation_digest":"sha256:ac8448123ff76d0a0a696add3a8f930f0e4477d07e665739415dc44678762eae","observation_id":"326cb922-af5f-47c9-84b4-e5d544e91a91","resolution":{"observed_at":"2026-08-05T19:01:41.874164Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T19:01:41.560705Z","title":"XTab: cross-table pretraining for tabular transformers","venue":null,"work_id":"550f7554-41f1-4eb3-97c3-04160bebb0a5","year":2023},"citing_paper":{"arxiv_id":"2508.14130","last_updated":"2025-08-19T06:58:16Z","snapshot_observed_at":"2026-08-09T19:23:14.500136Z","submitted_at":"2025-08-19T06:58:16Z","title":"EmoSLLM: Parameter-Efficient Adaptation of LLMs for Speech Emotion Recognition","version":1},"reference_index":69,"source":"pdf_text","source_observed_at":"2026-08-05T19:01:24.823489Z"},"links":{"citing_paper":"/paper/2508.14130"},"observation_digest":"sha256:54e3db02d64ad5a883c67ed6e265e3ca093ab9400cce6b73fdba992f6a453408","observation_id":"8be054d5-7c0e-4a08-ace2-3738e3b75aaa","resolution":{"observed_at":"2026-08-05T19:01:41.627401Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T19:01:41.398311Z","title":"role\": \"system","venue":null,"work_id":"eea983bd-2061-43c8-b240-07905c2ae47e","year":2023},"citing_paper":{"arxiv_id":"2508.14130","last_updated":"2025-08-19T06:58:16Z","snapshot_observed_at":"2026-08-09T19:23:14.500136Z","submitted_at":"2025-08-19T06:58:16Z","title":"EmoSLLM: Parameter-Efficient Adaptation of LLMs for Speech Emotion Recognition","version":1},"reference_index":70,"source":"pdf_text","source_observed_at":"2026-08-05T19:01:24.881803Z"},"links":{"citing_paper":"/paper/2508.14130"},"observation_digest":"sha256:eeed646d34b72a20f011aedc6664d2c2a49bd85867ffab4cc068816aeff68082","observation_id":"b964a577-3280-4235-9c38-8196d83c06d3","resolution":{"observed_at":"2026-08-05T19:01:41.461050Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T19:01:41.150640Z","title":null,"venue":null,"work_id":"39e632e2-eb57-4ce0-a720-43c64e2b3445","year":null},"citing_paper":{"arxiv_id":"2508.14130","last_updated":"2025-08-19T06:58:16Z","snapshot_observed_at":"2026-08-09T19:23:14.500136Z","submitted_at":"2025-08-19T06:58:16Z","title":"EmoSLLM: Parameter-Efficient Adaptation of LLMs for Speech Emotion Recognition","version":1},"reference_index":71,"source":"pdf_text","source_observed_at":"2026-08-05T19:01:24.967275Z"},"links":{"citing_paper":"/paper/2508.14130"},"observation_digest":"sha256:450ad5c886791f0a746e7d7034d4a63ddf76a404e7f8327d686a89df23131d5a","observation_id":"657de9e1-c6dd-498f-9983-c9b061b92936","resolution":{"observed_at":"2026-08-05T19:01:41.251542Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T19:01:40.941314Z","title":"role\": \"user","venue":null,"work_id":"df51cf78-5712-4999-b3ca-07e0091ebff6","year":null},"citing_paper":{"arxiv_id":"2508.14130","last_updated":"2025-08-19T06:58:16Z","snapshot_observed_at":"2026-08-09T19:23:14.500136Z","submitted_at":"2025-08-19T06:58:16Z","title":"EmoSLLM: Parameter-Efficient Adaptation of LLMs for Speech Emotion Recognition","version":1},"reference_index":72,"source":"pdf_text","source_observed_at":"2026-08-05T19:01:25.055295Z"},"links":{"citing_paper":"/paper/2508.14130"},"observation_digest":"sha256:aeac18726673c3a63e777fb0fa69a8d463c32c97eba71fbbf2205b695dd6a069","observation_id":"d493cb03-0b91-4a44-a5d0-7c045ba05ad5","resolution":{"observed_at":"2026-08-05T19:01:41.032813Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T19:01:40.728414Z","title":"Identify and write down the words spoken in the preceding audio","venue":null,"work_id":"42f054e3-ebaf-4317-a062-11455dba908a","year":null},"citing_paper":{"arxiv_id":"2508.14130","last_updated":"2025-08-19T06:58:16Z","snapshot_observed_at":"2026-08-09T19:23:14.500136Z","submitted_at":"2025-08-19T06:58:16Z","title":"EmoSLLM: Parameter-Efficient Adaptation of LLMs for Speech Emotion Recognition","version":1},"reference_index":73,"source":"pdf_text","source_observed_at":"2026-08-05T19:01:25.146172Z"},"links":{"citing_paper":"/paper/2508.14130"},"observation_digest":"sha256:c50e198a0843fe0c69b5a64bdced85304f364b4399218ae84915e757ac0abc50","observation_id":"066c914b-30eb-434d-a273-b3f133287e22","resolution":{"observed_at":"2026-08-05T19:01:40.831038Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T19:01:40.541169Z","title":"role\": \"user","venue":null,"work_id":"c15368f4-d7f1-499d-9371-3f898c6a4a51","year":null},"citing_paper":{"arxiv_id":"2508.14130","last_updated":"2025-08-19T06:58:16Z","snapshot_observed_at":"2026-08-09T19:23:14.500136Z","submitted_at":"2025-08-19T06:58:16Z","title":"EmoSLLM: Parameter-Efficient Adaptation of LLMs for Speech Emotion Recognition","version":1},"reference_index":74,"source":"pdf_text","source_observed_at":"2026-08-05T19:01:25.208175Z"},"links":{"citing_paper":"/paper/2508.14130"},"observation_digest":"sha256:0468f9b4ea832230e14907e716dc18a84a80706e6084fdf8eaa52f784244adc7","observation_id":"56d56ad6-ed4e-4375-8d26-32bc19de6274","resolution":{"observed_at":"2026-08-05T19:01:40.615378Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}}],"paper":{"arxiv_id":"2508.14130","last_updated":"2025-08-19T06:58:16Z","latest_version":1,"primary_category":"eess.AS","snapshot_observed_at":"2026-08-09T19:23:14.500136Z","submitted_at":"2025-08-19T06:58:16Z","title":"EmoSLLM: Parameter-Efficient Adaptation of LLMs for Speech Emotion Recognition"},"reference_resolution":{"displayed":74,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":18,"verified_exact":0,"verified_fuzzy":56},"total_outbound_references":74},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"thesis":"As of 10 August 2026, this Paper Citation Record lists 74 of 74 outbound references and 4 inbound Pith citation observations for arXiv:2508.14130."}