{"as_of":"2026-08-09T19:03:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:73e3157caf855a2d010f22c400993771e21ef58842e3efd548e2a04d7e519cc9","coverage":[{"denominator":31,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":31,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-05T21:45:24.518469Z","state":"measured"},{"denominator":31,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":31,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-09T06:31:02.800959+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2508.08095/citation-record","integrity":"/paper/2508.08095/integrity","json":"/paper/2508.08095/citation-record.json","paper":"/paper/2508.08095"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T21:45:27.902837Z","title":"Towards emotional support dialog systems,","venue":null,"work_id":"1f617b6a-fa0e-4bef-9fea-8705362d88cb","year":2021},"citing_paper":{"arxiv_id":"2508.08095","last_updated":"2025-08-11T15:33:44Z","snapshot_observed_at":"2026-08-07T16:13:39.029257Z","submitted_at":"2025-08-11T15:33:44Z","title":"Dual Information Speech Language Models for Emotional Conversations","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-05T21:45:21.710941Z"},"links":{"citing_paper":"/paper/2508.08095"},"observation_digest":"sha256:f6bb0925cc0a87d033b5611d5246c0bd15b3e7592023fc344988dd4beb244396","observation_id":"023b16f8-f232-4b6d-ac52-531636f62c4d","resolution":{"observed_at":"2026-08-05T21:45:27.983267Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T21:45:27.702845Z","title":"Advancing large language models to capture varied speaking styles and respond properly in spoken conversations,","venue":null,"work_id":"34a959e2-1f5c-4857-8d52-e522c8728a23","year":2024},"citing_paper":{"arxiv_id":"2508.08095","last_updated":"2025-08-11T15:33:44Z","snapshot_observed_at":"2026-08-07T16:13:39.029257Z","submitted_at":"2025-08-11T15:33:44Z","title":"Dual Information Speech Language Models for Emotional Conversations","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-05T21:45:21.812884Z"},"links":{"citing_paper":"/paper/2508.08095"},"observation_digest":"sha256:078312bf991e85f5febcfb9a5172a5347a5a15c3ed2db7595f3c5aac39596884","observation_id":"2fd5faf8-77f0-42b6-8ed4-1c4347e2aeef","resolution":{"observed_at":"2026-08-05T21:45:27.811857Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T21:45:27.553035Z","title":"Paralinguistics-enhanced large language modeling of spoken dialogue,","venue":null,"work_id":"ad72d7d2-a492-42b9-8814-94df13a11b2f","year":2024},"citing_paper":{"arxiv_id":"2508.08095","last_updated":"2025-08-11T15:33:44Z","snapshot_observed_at":"2026-08-07T16:13:39.029257Z","submitted_at":"2025-08-11T15:33:44Z","title":"Dual Information Speech Language Models for Emotional Conversations","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-05T21:45:21.891427Z"},"links":{"citing_paper":"/paper/2508.08095"},"observation_digest":"sha256:6b4ee94291e282cf6cb220647b11558eae53757b05fe85a78e45c466968014aa","observation_id":"29000374-5301-4476-85e3-3b00a296f15a","resolution":{"observed_at":"2026-08-05T21:45:27.610817Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2401.00475","last_updated":"2024-07-27T07:45:43Z","snapshot_observed_at":"2026-08-04T15:15:20.818594Z","submitted_at":"2023-12-31T12:29:12Z","title":"E-chat: Emotion-sensitive Spoken Dialogue System with Large Language Models","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2401.00475","snapshot_observed_at":"2026-08-05T21:45:21.987977Z","title":"E-chat: Emotion-sensitive spoken dialogue system with large language models,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2508.08095","last_updated":"2025-08-11T15:33:44Z","snapshot_observed_at":"2026-08-07T16:13:39.029257Z","submitted_at":"2025-08-11T15:33:44Z","title":"Dual Information Speech Language Models for Emotional Conversations","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-05T21:45:21.987977Z"},"links":{"cited_paper":"/paper/2401.00475","citing_paper":"/paper/2508.08095"},"observation_digest":"sha256:38d938dbde98d442fab84095439e8fc5c5385d37b4aa5c2dd2eace83b67abe11","observation_id":"f70ed20d-683a-4069-ad05-ac7c5be8df1e","resolution":{"observed_at":"2026-08-05T21:45:21.987977Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2406.03872","last_updated":"2024-06-06T09:02:31Z","snapshot_observed_at":"2026-08-04T22:33:15.502958Z","submitted_at":"2024-06-06T09:02:31Z","title":"BLSP-Emo: Towards Empathetic Large Speech-Language Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2406.03872","snapshot_observed_at":"2026-08-05T21:45:22.097811Z","title":"Blsp-emo: Towards empathetic large speech- language models,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2508.08095","last_updated":"2025-08-11T15:33:44Z","snapshot_observed_at":"2026-08-07T16:13:39.029257Z","submitted_at":"2025-08-11T15:33:44Z","title":"Dual Information Speech Language Models for Emotional Conversations","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-05T21:45:22.097811Z"},"links":{"cited_paper":"/paper/2406.03872","citing_paper":"/paper/2508.08095"},"observation_digest":"sha256:9a0bc327af32613ee379e5178bb954cb21e155976e9cc5956f3df06fa3abcf0b","observation_id":"badd5617-2e54-4ac5-8af2-03674bf846a1","resolution":{"observed_at":"2026-08-05T21:45:22.097811Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2411.13577","last_updated":"2024-11-26T09:20:48Z","snapshot_observed_at":"2026-08-06T09:02:03.671500Z","submitted_at":"2024-11-15T04:16:45Z","title":"WavChat: A Survey of Spoken Dialogue Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2411.13577","snapshot_observed_at":"2026-08-05T21:45:22.176873Z","title":"Wavchat: A survey of spoken dialogue models,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2508.08095","last_updated":"2025-08-11T15:33:44Z","snapshot_observed_at":"2026-08-07T16:13:39.029257Z","submitted_at":"2025-08-11T15:33:44Z","title":"Dual Information Speech Language Models for Emotional Conversations","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-05T21:45:22.176873Z"},"links":{"cited_paper":"/paper/2411.13577","citing_paper":"/paper/2508.08095"},"observation_digest":"sha256:1ed9bc0301b9cad48aff6397f718115722436c86110affc57bb0b2c9b90fdf93","observation_id":"74403b0a-948f-405d-9850-ed7df164adbb","resolution":{"observed_at":"2026-08-05T21:45:22.176873Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T21:45:27.340053Z","title":"Connecting speech encoder and large language model for asr,","venue":null,"work_id":"754270c8-7f88-4d32-8276-163eaa350de5","year":2024},"citing_paper":{"arxiv_id":"2508.08095","last_updated":"2025-08-11T15:33:44Z","snapshot_observed_at":"2026-08-07T16:13:39.029257Z","submitted_at":"2025-08-11T15:33:44Z","title":"Dual Information Speech Language Models for Emotional Conversations","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-05T21:45:22.247832Z"},"links":{"citing_paper":"/paper/2508.08095"},"observation_digest":"sha256:02e4ae7cf4fa0bc5a05d02e31101fd63bad6a7c05d744be738d86869685aa580","observation_id":"c9d2b378-e387-440f-bf8f-d280dfba3e0d","resolution":{"observed_at":"2026-08-05T21:45:27.433636Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2402.08846","last_updated":"2024-02-13T23:25:04Z","snapshot_observed_at":"2026-08-06T09:11:01.697195Z","submitted_at":"2024-02-13T23:25:04Z","title":"An Embarrassingly Simple Approach for LLM with Strong ASR Capacity","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.08846","snapshot_observed_at":"2026-08-05T21:45:22.388008Z","title":"An embarrassingly simple approach for llm with strong asr capacity,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2508.08095","last_updated":"2025-08-11T15:33:44Z","snapshot_observed_at":"2026-08-07T16:13:39.029257Z","submitted_at":"2025-08-11T15:33:44Z","title":"Dual Information Speech Language Models for Emotional Conversations","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-05T21:45:22.388008Z"},"links":{"cited_paper":"/paper/2402.08846","citing_paper":"/paper/2508.08095"},"observation_digest":"sha256:fc100c203bcecc3c381c351c5e2bd82a0c6daf33dc422f2919fbf9b42e6d8ff9","observation_id":"d2ab4cb9-f143-45b2-9f74-ba441f2be27a","resolution":{"observed_at":"2026-08-05T21:45:22.388008Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2410.01162","last_updated":"2025-05-19T22:01:39Z","snapshot_observed_at":"2026-07-06T19:25:38.051475Z","submitted_at":"2024-10-02T01:32:47Z","title":"Frozen Large Language Models Can Perceive Paralinguistic Aspects of Speech","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2410.01162","snapshot_observed_at":"2026-08-05T21:45:22.464344Z","title":"Frozen large language models can perceive paralinguistic aspects of speech,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2508.08095","last_updated":"2025-08-11T15:33:44Z","snapshot_observed_at":"2026-08-07T16:13:39.029257Z","submitted_at":"2025-08-11T15:33:44Z","title":"Dual Information Speech Language Models for Emotional Conversations","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-05T21:45:22.464344Z"},"links":{"cited_paper":"/paper/2410.01162","citing_paper":"/paper/2508.08095"},"observation_digest":"sha256:705ca4dc44be5dfbb0df7f6d8be42216a58bb549ed9cf03528a72e613c1450e4","observation_id":"9d916934-dc42-40b7-8b6b-61e984cb33b0","resolution":{"observed_at":"2026-08-05T21:45:22.464344Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T21:45:27.164027Z","title":"Prefix-tuning: Optimizing continuous prompts for generation,","venue":null,"work_id":"178a4314-0d3c-40c6-83c6-8d36e760c978","year":2021},"citing_paper":{"arxiv_id":"2508.08095","last_updated":"2025-08-11T15:33:44Z","snapshot_observed_at":"2026-08-07T16:13:39.029257Z","submitted_at":"2025-08-11T15:33:44Z","title":"Dual Information Speech Language Models for Emotional Conversations","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-05T21:45:22.613988Z"},"links":{"citing_paper":"/paper/2508.08095"},"observation_digest":"sha256:fc9c47fe6741db2ceb49eb74ea1fae2b610f1a42af630b9d501f7fada2b0778d","observation_id":"5d0c1c21-a44d-4cc3-a0a5-e04b35f2d39a","resolution":{"observed_at":"2026-08-05T21:45:27.247680Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T21:45:26.978810Z","title":"AudioChatLlama: Towards general-purpose speech abilities for LLMs,","venue":null,"work_id":"6a487726-e4fb-4c67-b735-e4f41bb6987e","year":2024},"citing_paper":{"arxiv_id":"2508.08095","last_updated":"2025-08-11T15:33:44Z","snapshot_observed_at":"2026-08-07T16:13:39.029257Z","submitted_at":"2025-08-11T15:33:44Z","title":"Dual Information Speech Language Models for Emotional Conversations","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-05T21:45:22.693144Z"},"links":{"citing_paper":"/paper/2508.08095"},"observation_digest":"sha256:38a9a53755f0c159cdf61238f589318003252786fe0cbaeda912edf19aac7c86","observation_id":"39842294-ec26-4b48-8cdf-8fabd6c0fd86","resolution":{"observed_at":"2026-08-05T21:45:27.053593Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2110.07602","last_updated":"2022-03-20T15:13:08Z","snapshot_observed_at":"2026-08-08T11:15:37.346201Z","submitted_at":"2021-10-14T17:58:47Z","title":"P-Tuning v2: Prompt Tuning Can Be Comparable to Fine-tuning Universally Across Scales and Tasks","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2110.07602","snapshot_observed_at":"2026-08-05T21:45:22.786563Z","title":"P-tuning v2: Prompt tuning can be comparable to fine- tuning universally across scales and tasks,","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2508.08095","last_updated":"2025-08-11T15:33:44Z","snapshot_observed_at":"2026-08-07T16:13:39.029257Z","submitted_at":"2025-08-11T15:33:44Z","title":"Dual Information Speech Language Models for Emotional Conversations","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-05T21:45:22.786563Z"},"links":{"cited_paper":"/paper/2110.07602","citing_paper":"/paper/2508.08095"},"observation_digest":"sha256:ae1487618544dbffe6ed0f6d7c766bd9f090be518605d5eb7f2a1168972382e8","observation_id":"246a53c1-09e4-4d34-81bb-321ee383cd53","resolution":{"observed_at":"2026-08-05T21:45:22.786563Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T21:45:26.815488Z","title":"Secap: Speech emotion captioning with large language model,","venue":null,"work_id":"9443e22c-5d77-480d-a486-375ee37c8dcb","year":2024},"citing_paper":{"arxiv_id":"2508.08095","last_updated":"2025-08-11T15:33:44Z","snapshot_observed_at":"2026-08-07T16:13:39.029257Z","submitted_at":"2025-08-11T15:33:44Z","title":"Dual Information Speech Language Models for Emotional Conversations","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-05T21:45:22.897147Z"},"links":{"citing_paper":"/paper/2508.08095"},"observation_digest":"sha256:54c1aa9531c18c7d9e06e2f246351a4f003c5db1b2a68e94f46c842f065205eb","observation_id":"306c0a74-e426-4272-bc5d-06735aedee23","resolution":{"observed_at":"2026-08-05T21:45:26.886740Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T21:45:26.672160Z","title":"Stylecap: Automatic speaking-style captioning from speech based on speech and language self-supervised learning models,","venue":null,"work_id":"0fdb2bc6-399e-45a0-96f3-a5da42aa08d6","year":2024},"citing_paper":{"arxiv_id":"2508.08095","last_updated":"2025-08-11T15:33:44Z","snapshot_observed_at":"2026-08-07T16:13:39.029257Z","submitted_at":"2025-08-11T15:33:44Z","title":"Dual Information Speech Language Models for Emotional Conversations","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-05T21:45:22.953545Z"},"links":{"citing_paper":"/paper/2508.08095"},"observation_digest":"sha256:95a6750f2f38be1ff52f5d5afe1dfaeafe24ecdd7b06a828cae937b04b05448f","observation_id":"568692f7-dfc3-4e27-bbe4-b75835cd4477","resolution":{"observed_at":"2026-08-05T21:45:26.754260Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2407.10759","last_updated":"2024-07-15T14:38:09Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-07-15T14:38:09Z","title":"Qwen2-Audio Technical Report","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2407.10759","snapshot_observed_at":"2026-08-05T21:45:23.049151Z","title":"Qwen2-audio technical report,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2508.08095","last_updated":"2025-08-11T15:33:44Z","snapshot_observed_at":"2026-08-07T16:13:39.029257Z","submitted_at":"2025-08-11T15:33:44Z","title":"Dual Information Speech Language Models for Emotional Conversations","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-05T21:45:23.049151Z"},"links":{"cited_paper":"/paper/2407.10759","citing_paper":"/paper/2508.08095"},"observation_digest":"sha256:44e074fd71baa74bbf06b702173dc5c9e2b7eba00109e8887cbdcce8d678b9ed","observation_id":"793548fc-4a4c-4de7-adc4-683ce4ac6629","resolution":{"observed_at":"2026-08-05T21:45:23.049151Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T21:45:26.519091Z","title":"The power of scale for parameter-efficient prompt tuning,","venue":null,"work_id":"a4c9ab94-faa1-4d8a-b6d2-aa56759c6da0","year":2021},"citing_paper":{"arxiv_id":"2508.08095","last_updated":"2025-08-11T15:33:44Z","snapshot_observed_at":"2026-08-07T16:13:39.029257Z","submitted_at":"2025-08-11T15:33:44Z","title":"Dual Information Speech Language Models for Emotional Conversations","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-05T21:45:23.165427Z"},"links":{"citing_paper":"/paper/2508.08095"},"observation_digest":"sha256:649d88aa110d3a1784a09fef64f578ce03e9eca70013166fea0d4f41e14d9568","observation_id":"4d2b4f50-cebe-4ba4-bbab-19f35d7cb3da","resolution":{"observed_at":"2026-08-05T21:45:26.587093Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T21:45:26.411196Z","title":"Multitask prompt tuning enables parameter-efficient transfer learning,","venue":null,"work_id":"941de86b-0dbd-4c93-b240-d09b3efd28fe","year":2023},"citing_paper":{"arxiv_id":"2508.08095","last_updated":"2025-08-11T15:33:44Z","snapshot_observed_at":"2026-08-07T16:13:39.029257Z","submitted_at":"2025-08-11T15:33:44Z","title":"Dual Information Speech Language Models for Emotional Conversations","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-05T21:45:23.275885Z"},"links":{"citing_paper":"/paper/2508.08095"},"observation_digest":"sha256:f58b7448ac243727de0e9d54c4b3a5f9adee01da60a43bf9ba3651e693ec9604","observation_id":"24400545-1282-4060-8997-d2d214ffb384","resolution":{"observed_at":"2026-08-05T21:45:26.462844Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T21:45:26.244418Z","title":"Factor-conditioned speaking-style captioning,","venue":null,"work_id":"0116eca4-a5db-4198-95ec-3597f3a761a4","year":2024},"citing_paper":{"arxiv_id":"2508.08095","last_updated":"2025-08-11T15:33:44Z","snapshot_observed_at":"2026-08-07T16:13:39.029257Z","submitted_at":"2025-08-11T15:33:44Z","title":"Dual Information Speech Language Models for Emotional Conversations","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-05T21:45:23.410486Z"},"links":{"citing_paper":"/paper/2508.08095"},"observation_digest":"sha256:b2a948e062a28d00bd48ae4fbfc12b7b0b0219819e302999dee7195956047717","observation_id":"85ab5a0e-da1e-4863-ad51-c46e1ef307ec","resolution":{"observed_at":"2026-08-05T21:45:26.321953Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T21:45:26.080474Z","title":"Developing instruction-following speech language model without speech instruction-tuning data,","venue":null,"work_id":"d2ec505d-d943-464f-aef6-b10cbf10e6d5","year":2025},"citing_paper":{"arxiv_id":"2508.08095","last_updated":"2025-08-11T15:33:44Z","snapshot_observed_at":"2026-08-07T16:13:39.029257Z","submitted_at":"2025-08-11T15:33:44Z","title":"Dual Information Speech Language Models for Emotional Conversations","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-05T21:45:23.503271Z"},"links":{"citing_paper":"/paper/2508.08095"},"observation_digest":"sha256:4b40aee2df7b44068491a7e2afff4758a91c3924e7e4100261abf6805ab40673","observation_id":"96c53e59-f4c2-476b-9bf5-9215af47b2d4","resolution":{"observed_at":"2026-08-05T21:45:26.159406Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T21:45:25.918202Z","title":"Textrolspeech: A text style control speech corpus with codec language text-to-speech models,","venue":null,"work_id":"ce78c10b-41b4-4bb0-86af-a727a4fa20a4","year":2024},"citing_paper":{"arxiv_id":"2508.08095","last_updated":"2025-08-11T15:33:44Z","snapshot_observed_at":"2026-08-07T16:13:39.029257Z","submitted_at":"2025-08-11T15:33:44Z","title":"Dual Information Speech Language Models for Emotional Conversations","version":1},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-05T21:45:23.581006Z"},"links":{"citing_paper":"/paper/2508.08095"},"observation_digest":"sha256:0bb084d7c10ffa75efbb8b95ec171a9e425a301ea3c052c50f1992ce6724733b","observation_id":"792d39f8-481b-4be4-b504-921685e13154","resolution":{"observed_at":"2026-08-05T21:45:25.993215Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T21:45:25.732529Z","title":"MELD: A multimodal multi-party dataset for emotion recognition in conversations,","venue":null,"work_id":"66c0a1a0-6779-4745-84ce-df8c5cbcae6e","year":2019},"citing_paper":{"arxiv_id":"2508.08095","last_updated":"2025-08-11T15:33:44Z","snapshot_observed_at":"2026-08-07T16:13:39.029257Z","submitted_at":"2025-08-11T15:33:44Z","title":"Dual Information Speech Language Models for Emotional Conversations","version":1},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-05T21:45:23.695583Z"},"links":{"citing_paper":"/paper/2508.08095"},"observation_digest":"sha256:f99c9de6c1b14284de12c1bfbca884ac1d8f58031d7ce77d3f9d7d12d04e1b79","observation_id":"b1b77b22-0a61-443a-86fe-d66d95a2aff7","resolution":{"observed_at":"2026-08-05T21:45:25.831124Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T21:45:25.570498Z","title":"Dailytalk: Spoken dialogue dataset for conversational text-to-speech,","venue":null,"work_id":"039e7d0f-bdfb-4d44-8df6-a6fed2e6e125","year":2023},"citing_paper":{"arxiv_id":"2508.08095","last_updated":"2025-08-11T15:33:44Z","snapshot_observed_at":"2026-08-07T16:13:39.029257Z","submitted_at":"2025-08-11T15:33:44Z","title":"Dual Information Speech Language Models for Emotional Conversations","version":1},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-05T21:45:23.771930Z"},"links":{"citing_paper":"/paper/2508.08095"},"observation_digest":"sha256:a83f5be02bfb35a35e33b3050ed3eecfa1e77c8051a4b4ffe8c716108836b22a","observation_id":"58755def-fe82-4cd1-8e3a-6cf3c55178e0","resolution":{"observed_at":"2026-08-05T21:45:25.642640Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T21:45:25.375383Z","title":"DailyDialog: A manually labelled multi-turn dialogue dataset,","venue":null,"work_id":"4495f93c-9925-4c1e-b172-d6e3aa7e8701","year":2017},"citing_paper":{"arxiv_id":"2508.08095","last_updated":"2025-08-11T15:33:44Z","snapshot_observed_at":"2026-08-07T16:13:39.029257Z","submitted_at":"2025-08-11T15:33:44Z","title":"Dual Information Speech Language Models for Emotional Conversations","version":1},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-05T21:45:23.839897Z"},"links":{"citing_paper":"/paper/2508.08095"},"observation_digest":"sha256:6ed8768c221277747c1b79ddfcc97a8bc63457484e7a0798fc531caa7912766e","observation_id":"c7f7120f-e0e7-4d47-8b88-15967f768e76","resolution":{"observed_at":"2026-08-05T21:45:25.465767Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2409.06666","last_updated":"2025-03-01T12:59:49Z","snapshot_observed_at":"2026-07-06T19:13:20.458958Z","submitted_at":"2024-09-10T17:34:34Z","title":"LLaMA-Omni: Seamless Speech Interaction with Large Language Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2409.06666","snapshot_observed_at":"2026-08-05T21:45:23.907075Z","title":"Llama-omni: Seamless speech interaction with large language models,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2508.08095","last_updated":"2025-08-11T15:33:44Z","snapshot_observed_at":"2026-08-07T16:13:39.029257Z","submitted_at":"2025-08-11T15:33:44Z","title":"Dual Information Speech Language Models for Emotional Conversations","version":1},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-05T21:45:23.907075Z"},"links":{"cited_paper":"/paper/2409.06666","citing_paper":"/paper/2508.08095"},"observation_digest":"sha256:769837001fc02ec95cd6860cf07131068b52c8323eaefe02d524fbdf40338f69","observation_id":"60e45a49-bb4c-47c9-8812-24061e498963","resolution":{"observed_at":"2026-08-05T21:45:23.907075Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2401.06836","last_updated":"2024-08-07T08:09:53Z","snapshot_observed_at":"2026-08-05T03:31:28.874008Z","submitted_at":"2024-01-12T16:42:10Z","title":"Enhancing Emotional Generation Capability of Large Language Models via Emotional Chain-of-Thought","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2401.06836","snapshot_observed_at":"2026-08-05T21:45:23.985849Z","title":"Enhancing emotional generation capability of large language models via emotional chain-of-thought,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2508.08095","last_updated":"2025-08-11T15:33:44Z","snapshot_observed_at":"2026-08-07T16:13:39.029257Z","submitted_at":"2025-08-11T15:33:44Z","title":"Dual Information Speech Language Models for Emotional Conversations","version":1},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-08-05T21:45:23.985849Z"},"links":{"cited_paper":"/paper/2401.06836","citing_paper":"/paper/2508.08095"},"observation_digest":"sha256:4be6bf2355f26760e17fcbce99256cd3fd2c55f45f5ec868ba23aac3ed58fb61","observation_id":"4a0e96f7-a40c-4f96-8799-3a84dff6ff16","resolution":{"observed_at":"2026-08-05T21:45:23.985849Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T21:45:25.238475Z","title":"Robust speech recognition via large-scale weak supervision,","venue":null,"work_id":"4f118859-f334-4ecf-8a1e-a15b0061d7cd","year":2023},"citing_paper":{"arxiv_id":"2508.08095","last_updated":"2025-08-11T15:33:44Z","snapshot_observed_at":"2026-08-07T16:13:39.029257Z","submitted_at":"2025-08-11T15:33:44Z","title":"Dual Information Speech Language Models for Emotional Conversations","version":1},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-08-05T21:45:24.080046Z"},"links":{"citing_paper":"/paper/2508.08095"},"observation_digest":"sha256:217ee359d79b7ea04ebc0c579e01329af91970249319361be4ae9209c688cbd9","observation_id":"d5f62a89-62e8-4483-8378-ed1b28e34d37","resolution":{"observed_at":"2026-08-05T21:45:25.302036Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T21:45:25.071190Z","title":"Qwen2.5: A party of foundation models,","venue":null,"work_id":"5a8e6224-707c-47c4-b9e5-240fe02d1fed","year":2024},"citing_paper":{"arxiv_id":"2508.08095","last_updated":"2025-08-11T15:33:44Z","snapshot_observed_at":"2026-08-07T16:13:39.029257Z","submitted_at":"2025-08-11T15:33:44Z","title":"Dual Information Speech Language Models for Emotional Conversations","version":1},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-08-05T21:45:24.159674Z"},"links":{"citing_paper":"/paper/2508.08095"},"observation_digest":"sha256:4350323255d4488f7a87b07a5c69c90046228ce356e2dbda61f6aad1771fe7ae","observation_id":"00ad5a76-e8d1-46c8-be3b-6931aa7534a1","resolution":{"observed_at":"2026-08-05T21:45:25.140468Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2407.21783","last_updated":"2024-11-23T23:27:33Z","snapshot_observed_at":"2026-07-06T18:55:11.576666Z","submitted_at":"2024-07-31T17:54:27Z","title":"The Llama 3 Herd of Models","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2407.21783","snapshot_observed_at":"2026-08-05T21:45:24.267806Z","title":"The llama 3 herd of models,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2508.08095","last_updated":"2025-08-11T15:33:44Z","snapshot_observed_at":"2026-08-07T16:13:39.029257Z","submitted_at":"2025-08-11T15:33:44Z","title":"Dual Information Speech Language Models for Emotional Conversations","version":1},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-08-05T21:45:24.267806Z"},"links":{"cited_paper":"/paper/2407.21783","citing_paper":"/paper/2508.08095"},"observation_digest":"sha256:003b357d3c124e1afe31f85920dde6ef8c464b8f966cfd4159db998c61d81a5c","observation_id":"d8edb898-90d4-4542-a7b3-47ce4f314b6d","resolution":{"observed_at":"2026-08-05T21:45:24.267806Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T21:45:24.886262Z","title":"emotion2vec: Self-supervised pre-training for speech emotion representation,","venue":null,"work_id":"2910d309-6e69-4b8c-8d72-b9cd9021eebb","year":2024},"citing_paper":{"arxiv_id":"2508.08095","last_updated":"2025-08-11T15:33:44Z","snapshot_observed_at":"2026-08-07T16:13:39.029257Z","submitted_at":"2025-08-11T15:33:44Z","title":"Dual Information Speech Language Models for Emotional Conversations","version":1},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-08-05T21:45:24.367371Z"},"links":{"citing_paper":"/paper/2508.08095"},"observation_digest":"sha256:1e9e577aa47e8ea2520c6c9dcd70ebacea56590a115cdc28fbe572c06afe86af","observation_id":"2fa7f6e5-f4eb-4bef-a256-8e1a53b5d506","resolution":{"observed_at":"2026-08-05T21:45:24.959395Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2311.07919","last_updated":"2023-12-21T10:20:42Z","snapshot_observed_at":"2026-08-07T10:17:55.688598Z","submitted_at":"2023-11-14T05:34:50Z","title":"Qwen-Audio: Advancing Universal Audio Understanding via Unified Large-Scale Audio-Language Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2311.07919","snapshot_observed_at":"2026-08-05T21:45:24.447487Z","title":"Qwen-audio: Advancing universal audio understand- ing via unified large-scale audio-language models,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2508.08095","last_updated":"2025-08-11T15:33:44Z","snapshot_observed_at":"2026-08-07T16:13:39.029257Z","submitted_at":"2025-08-11T15:33:44Z","title":"Dual Information Speech Language Models for Emotional Conversations","version":1},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-08-05T21:45:24.447487Z"},"links":{"cited_paper":"/paper/2311.07919","citing_paper":"/paper/2508.08095"},"observation_digest":"sha256:ed21d21b970cf4addb5451925e0a1f9ad8cea7a6794003d28baddecfc2dc0ca1","observation_id":"0fef669a-c530-4ed1-be1b-4252f2184801","resolution":{"observed_at":"2026-08-05T21:45:24.447487Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T21:45:24.726742Z","title":"SALMONN: Towards generic hearing abilities for large language models,","venue":null,"work_id":"2bb72478-ac46-45b9-af90-9aecd5ffff23","year":2024},"citing_paper":{"arxiv_id":"2508.08095","last_updated":"2025-08-11T15:33:44Z","snapshot_observed_at":"2026-08-07T16:13:39.029257Z","submitted_at":"2025-08-11T15:33:44Z","title":"Dual Information Speech Language Models for Emotional Conversations","version":1},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-08-05T21:45:24.518469Z"},"links":{"citing_paper":"/paper/2508.08095"},"observation_digest":"sha256:4601825f5811ef685d6dc3f1f3778afb3c622fce595e5641f14aa8bbf90358e9","observation_id":"6fb68982-cf30-4234-a071-0e15d3246bf2","resolution":{"observed_at":"2026-08-05T21:45:24.772470Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}}],"paper":{"arxiv_id":"2508.08095","last_updated":"2025-08-11T15:33:44Z","latest_version":1,"primary_category":"cs.CL","snapshot_observed_at":"2026-08-07T16:13:39.029257Z","submitted_at":"2025-08-11T15:33:44Z","title":"Dual Information Speech Language Models for Emotional Conversations"},"reference_resolution":{"displayed":31,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":11,"verified_exact":0,"verified_fuzzy":20},"total_outbound_references":31},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"thesis":"As of 9 August 2026, this Paper Citation Record lists 31 of 31 outbound references and 0 inbound Pith citation observations for arXiv:2508.08095."}