{"as_of":"2026-08-22T01:09:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:f4674c59db7cae25d95d37e6703fffb5758e8cf66ef2005a436b51d0caa18333","coverage":[{"denominator":69,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":69,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-07T19:27:25.060586Z","state":"measured"},{"denominator":69,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":69,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-21T06:32:19.484+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2608.06013/citation-record","integrity":"/paper/2608.06013/integrity","json":"/paper/2608.06013/citation-record.json","paper":"/paper/2608.06013"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T19:27:26.449065Z","title":"Emotional artificial intelligence in education: A systematic review and meta- analysis,","venue":null,"work_id":"2b2db779-6dc6-451d-bf7b-3d5d2ecb31e7","year":2025},"citing_paper":{"arxiv_id":"2608.06013","last_updated":"2026-08-06T13:18:24Z","snapshot_observed_at":"2026-08-17T18:08:51.282644Z","submitted_at":"2026-08-06T13:18:24Z","title":"OneEmo: A Unified Multimodal Reasoning Model for Emotion Perception, Understanding, and Interaction","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-07T19:27:24.792721Z"},"links":{"citing_paper":"/paper/2608.06013"},"observation_digest":"sha256:4fb274bda357109d448a8ab280e4e05075e2a4cdc9bf0ed25d86fe553da59543","observation_id":"a6bfaada-8ae4-4bc1-8017-27f1b44cf61d","resolution":{"observed_at":"2026-08-07T19:27:26.452767Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T19:27:26.438121Z","title":"Artificial emotional intelligence: Conven- tional and deep learning approach,","venue":null,"work_id":"00fa966a-3fc0-4446-8671-3f0802f6aa92","year":2023},"citing_paper":{"arxiv_id":"2608.06013","last_updated":"2026-08-06T13:18:24Z","snapshot_observed_at":"2026-08-17T18:08:51.282644Z","submitted_at":"2026-08-06T13:18:24Z","title":"OneEmo: A Unified Multimodal Reasoning Model for Emotion Perception, Understanding, and Interaction","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-07T19:27:24.796652Z"},"links":{"citing_paper":"/paper/2608.06013"},"observation_digest":"sha256:a19c7e9520c7ece23fd94e79be5c3cea3334736cb43e86bd5fdcda7c305248e5","observation_id":"61b78a06-78aa-42bb-800a-293a02505e14","resolution":{"observed_at":"2026-08-07T19:27:26.441970Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T19:27:26.425601Z","title":"Voice in human–agent interaction,","venue":null,"work_id":"2fefee08-1da2-4228-9885-1f912220e19f","year":2021},"citing_paper":{"arxiv_id":"2608.06013","last_updated":"2026-08-06T13:18:24Z","snapshot_observed_at":"2026-08-17T18:08:51.282644Z","submitted_at":"2026-08-06T13:18:24Z","title":"OneEmo: A Unified Multimodal Reasoning Model for Emotion Perception, Understanding, and Interaction","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-07T19:27:24.800500Z"},"links":{"citing_paper":"/paper/2608.06013"},"observation_digest":"sha256:5ca436e8f169b9cf339c3b7a10625237270f8e9d27b5c173426596a860b617e1","observation_id":"9635cf96-4c49-4aae-b5b9-2391310d59e3","resolution":{"observed_at":"2026-08-07T19:27:26.430816Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T19:27:26.415572Z","title":"Emotion-llama: Multimodal emotion recognition and reasoning with instruction tuning,","venue":null,"work_id":"25dd3026-48f7-4882-a649-bc814d189a89","year":2024},"citing_paper":{"arxiv_id":"2608.06013","last_updated":"2026-08-06T13:18:24Z","snapshot_observed_at":"2026-08-17T18:08:51.282644Z","submitted_at":"2026-08-06T13:18:24Z","title":"OneEmo: A Unified Multimodal Reasoning Model for Emotion Perception, Understanding, and Interaction","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-07T19:27:24.803840Z"},"links":{"citing_paper":"/paper/2608.06013"},"observation_digest":"sha256:2f6d9f435309b5af516bafb19778a3bdd09f575e31e56fc863153d2bc99b55d7","observation_id":"c6202fa3-925d-47ca-9b17-c9b02c428972","resolution":{"observed_at":"2026-08-07T19:27:26.418929Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T19:27:26.404490Z","title":"Affectgpt: A new dataset, model, and benchmark for emotion understanding with multimodal large language models,","venue":null,"work_id":"93ad0d1c-5054-4321-928a-a100f900f94b","year":2025},"citing_paper":{"arxiv_id":"2608.06013","last_updated":"2026-08-06T13:18:24Z","snapshot_observed_at":"2026-08-17T18:08:51.282644Z","submitted_at":"2026-08-06T13:18:24Z","title":"OneEmo: A Unified Multimodal Reasoning Model for Emotion Perception, Understanding, and Interaction","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-07T19:27:24.807282Z"},"links":{"citing_paper":"/paper/2608.06013"},"observation_digest":"sha256:a7925695520dc028c3a9fdc76eb3e2a46eeb50ed80f2d87fbaa8428b7aac1d33","observation_id":"4c06e640-9216-43a1-9880-ead2da93cc2e","resolution":{"observed_at":"2026-08-07T19:27:26.408460Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T19:27:26.393966Z","title":"Towards multimodal empathetic response generation: A rich text-speech-vision avatar-based benchmark,","venue":null,"work_id":"d88a842a-6cd4-4e46-919c-d7f9fa13c8d2","year":2025},"citing_paper":{"arxiv_id":"2608.06013","last_updated":"2026-08-06T13:18:24Z","snapshot_observed_at":"2026-08-17T18:08:51.282644Z","submitted_at":"2026-08-06T13:18:24Z","title":"OneEmo: A Unified Multimodal Reasoning Model for Emotion Perception, Understanding, and Interaction","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-07T19:27:24.811171Z"},"links":{"citing_paper":"/paper/2608.06013"},"observation_digest":"sha256:0b74226f21a6d7f4a10a27367afa436ed8a3ab906092c706009aa53ec353b966","observation_id":"f0aad125-4fac-4869-b045-f0864e419505","resolution":{"observed_at":"2026-08-07T19:27:26.397751Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T19:27:26.383882Z","title":"E3rg: Building explicit emotion-driven empathetic response gen- eration system with multimodal large language model,","venue":null,"work_id":"999375c9-e63a-45fc-ac2a-90473c5549ef","year":2025},"citing_paper":{"arxiv_id":"2608.06013","last_updated":"2026-08-06T13:18:24Z","snapshot_observed_at":"2026-08-17T18:08:51.282644Z","submitted_at":"2026-08-06T13:18:24Z","title":"OneEmo: A Unified Multimodal Reasoning Model for Emotion Perception, Understanding, and Interaction","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-07T19:27:24.815370Z"},"links":{"citing_paper":"/paper/2608.06013"},"observation_digest":"sha256:0cd194225f7a7b0da4da60b519003f606f312834f0de7b6d36babe9fecdb851b","observation_id":"f22b8e92-b1e8-4aab-a04f-b1039d0204cc","resolution":{"observed_at":"2026-08-07T19:27:26.387598Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2501.12948","last_updated":"2026-01-04T03:57:36Z","snapshot_observed_at":"2026-08-15T12:33:55.451951Z","submitted_at":"2025-01-22T15:19:35Z","title":"DeepSeek-R1: Incentivizing Reasoning Capability in LLMs via Reinforcement Learning","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2501.12948","snapshot_observed_at":"2026-08-07T19:27:24.819092Z","title":"Deepseek-r1: Incentivizing reasoning capability in llms via reinforcement learning,","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2608.06013","last_updated":"2026-08-06T13:18:24Z","snapshot_observed_at":"2026-08-17T18:08:51.282644Z","submitted_at":"2026-08-06T13:18:24Z","title":"OneEmo: A Unified Multimodal Reasoning Model for Emotion Perception, Understanding, and Interaction","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-07T19:27:24.819092Z"},"links":{"cited_paper":"/paper/2501.12948","citing_paper":"/paper/2608.06013"},"observation_digest":"sha256:a9aba4a924ac171ff835bd02005e784eba1dcb75ef3001f5f9929443a89141a5","observation_id":"4d8f0d0f-a866-4f92-a47d-23e8b1c86ddd","resolution":{"observed_at":"2026-08-07T19:27:24.819092Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2503.05379","last_updated":"2025-03-10T07:11:14Z","snapshot_observed_at":"2026-08-18T17:42:46.393429Z","submitted_at":"2025-03-07T12:46:42Z","title":"R1-Omni: Explainable Omni-Multimodal Emotion Recognition with Reinforcement Learning","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2503.05379","snapshot_observed_at":"2026-08-07T19:27:24.823469Z","title":"R1-omni: Explainable omni-multimodal emotion recognition with reinforcement learning,","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2608.06013","last_updated":"2026-08-06T13:18:24Z","snapshot_observed_at":"2026-08-17T18:08:51.282644Z","submitted_at":"2026-08-06T13:18:24Z","title":"OneEmo: A Unified Multimodal Reasoning Model for Emotion Perception, Understanding, and Interaction","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-07T19:27:24.823469Z"},"links":{"cited_paper":"/paper/2503.05379","citing_paper":"/paper/2608.06013"},"observation_digest":"sha256:c8ae3bb82313a4de832a82f870370b1aa0e27caf69425c03c5a57ae69d02c727","observation_id":"8ff1312e-e8be-449b-bbd2-69c5c61573f4","resolution":{"observed_at":"2026-08-07T19:27:24.823469Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T19:27:26.373695Z","title":"Emo-r3: Reflective reinforcement learning for emotional reasoning in multimodal large language models,","venue":null,"work_id":"2daf7364-7d83-4e7a-af89-4d4fa047d1ae","year":2026},"citing_paper":{"arxiv_id":"2608.06013","last_updated":"2026-08-06T13:18:24Z","snapshot_observed_at":"2026-08-17T18:08:51.282644Z","submitted_at":"2026-08-06T13:18:24Z","title":"OneEmo: A Unified Multimodal Reasoning Model for Emotion Perception, Understanding, and Interaction","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-07T19:27:24.827494Z"},"links":{"citing_paper":"/paper/2608.06013"},"observation_digest":"sha256:27df19a5741ca6dc2bcab93f84713651de8bc1033ebc2991d27a3d1b1a0a3455","observation_id":"55f1d98b-d04a-456c-9a8e-a1ddcdc6b087","resolution":{"observed_at":"2026-08-07T19:27:26.377326Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T19:27:26.363814Z","title":"Facial- r1: Aligning reasoning and recognition for facial emotion analysis,","venue":null,"work_id":"32ed7631-5415-461f-a5d0-38638906563e","year":2026},"citing_paper":{"arxiv_id":"2608.06013","last_updated":"2026-08-06T13:18:24Z","snapshot_observed_at":"2026-08-17T18:08:51.282644Z","submitted_at":"2026-08-06T13:18:24Z","title":"OneEmo: A Unified Multimodal Reasoning Model for Emotion Perception, Understanding, and Interaction","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-07T19:27:24.831940Z"},"links":{"citing_paper":"/paper/2608.06013"},"observation_digest":"sha256:0ca9ad02d4c91f21b60ecde8d433ee7fed3ae2529d287af2dbea8a766491d3e5","observation_id":"6d92a104-aaac-41df-bcde-44eeb2a1921c","resolution":{"observed_at":"2026-08-07T19:27:26.366963Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T19:27:26.353084Z","title":"Nano-emox: Unifying multimodal emotional intelligence from per- ception to empathy,","venue":null,"work_id":"f5cfeee9-59cf-43e2-9fe8-75d7f8ea416c","year":2026},"citing_paper":{"arxiv_id":"2608.06013","last_updated":"2026-08-06T13:18:24Z","snapshot_observed_at":"2026-08-17T18:08:51.282644Z","submitted_at":"2026-08-06T13:18:24Z","title":"OneEmo: A Unified Multimodal Reasoning Model for Emotion Perception, Understanding, and Interaction","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-07T19:27:24.835947Z"},"links":{"citing_paper":"/paper/2608.06013"},"observation_digest":"sha256:955ffe1c4843973741c24b3a5ac5857aec0d90d2644ddf2bfb23d99761114988","observation_id":"c8c314f2-fed1-40c4-8c4e-1eeeeeb60901","resolution":{"observed_at":"2026-08-07T19:27:26.356857Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T19:27:24.840309Z","title":"Affectgpt-r1: Leveraging reinforcement learning for open-vocabulary multimodal emotion recognition,","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2608.06013","last_updated":"2026-08-06T13:18:24Z","snapshot_observed_at":"2026-08-17T18:08:51.282644Z","submitted_at":"2026-08-06T13:18:24Z","title":"OneEmo: A Unified Multimodal Reasoning Model for Emotion Perception, Understanding, and Interaction","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-07T19:27:24.840309Z"},"links":{"citing_paper":"/paper/2608.06013"},"observation_digest":"sha256:1472ed2ee1432ab9fd416f6db7dbd017980309a1a3a92a6c9ea81ba59c1c4c51","observation_id":"c28a5845-d1cc-4b2c-91d0-62fe087c9d83","resolution":{"observed_at":"2026-08-07T19:27:24.840309Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T19:27:26.341837Z","title":"Reinforce trustworthiness in multimodal emotional support system,","venue":null,"work_id":"25f4fef5-10c5-41f8-a279-3f4ee0baa954","year":2026},"citing_paper":{"arxiv_id":"2608.06013","last_updated":"2026-08-06T13:18:24Z","snapshot_observed_at":"2026-08-17T18:08:51.282644Z","submitted_at":"2026-08-06T13:18:24Z","title":"OneEmo: A Unified Multimodal Reasoning Model for Emotion Perception, Understanding, and Interaction","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-07T19:27:24.844506Z"},"links":{"citing_paper":"/paper/2608.06013"},"observation_digest":"sha256:7be520a3a75dd9c62f3db03abf5696f56e4257c682bced79741efd6816be0e35","observation_id":"dc4cc373-4389-4f63-8648-ebd04e00a543","resolution":{"observed_at":"2026-08-07T19:27:26.345750Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T19:27:26.330538Z","title":"Affective interaction and affective computing - past, present and future,","venue":null,"work_id":"8fdf87da-97d9-4b1b-9736-4e722a25ced4","year":2025},"citing_paper":{"arxiv_id":"2608.06013","last_updated":"2026-08-06T13:18:24Z","snapshot_observed_at":"2026-08-17T18:08:51.282644Z","submitted_at":"2026-08-06T13:18:24Z","title":"OneEmo: A Unified Multimodal Reasoning Model for Emotion Perception, Understanding, and Interaction","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-07T19:27:24.848009Z"},"links":{"citing_paper":"/paper/2608.06013"},"observation_digest":"sha256:7e0d0b604baeb4f3f4bd5712eb181c37aa39880857c0b96064a5c02bc9d91d44","observation_id":"5c766eaa-198f-4c08-b673-c7edcba4eec9","resolution":{"observed_at":"2026-08-07T19:27:26.334528Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T19:27:26.317861Z","title":"Videmo: Affective-tree reasoning for emotion-centric video foundation models,","venue":null,"work_id":"9cbb8dbf-cc74-4059-89cf-51beb0cf848a","year":2025},"citing_paper":{"arxiv_id":"2608.06013","last_updated":"2026-08-06T13:18:24Z","snapshot_observed_at":"2026-08-17T18:08:51.282644Z","submitted_at":"2026-08-06T13:18:24Z","title":"OneEmo: A Unified Multimodal Reasoning Model for Emotion Perception, Understanding, and Interaction","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-07T19:27:24.851773Z"},"links":{"citing_paper":"/paper/2608.06013"},"observation_digest":"sha256:238f0c6e87f5a56d4f810afcd114779e041a0614e72ec0579a2830b98f9d0b5e","observation_id":"650876d0-72fb-48c6-b659-847167f5d897","resolution":{"observed_at":"2026-08-07T19:27:26.321773Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2402.03300","last_updated":"2024-04-27T15:25:53Z","snapshot_observed_at":"2026-08-06T14:58:42.911363Z","submitted_at":"2024-02-05T18:55:32Z","title":"DeepSeekMath: Pushing the Limits of Mathematical Reasoning in Open Language Models","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.03300","snapshot_observed_at":"2026-08-07T19:27:24.856053Z","title":"Deepseekmath: Pushing the limits of mathematical reasoning in open language models,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2608.06013","last_updated":"2026-08-06T13:18:24Z","snapshot_observed_at":"2026-08-17T18:08:51.282644Z","submitted_at":"2026-08-06T13:18:24Z","title":"OneEmo: A Unified Multimodal Reasoning Model for Emotion Perception, Understanding, and Interaction","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-07T19:27:24.856053Z"},"links":{"cited_paper":"/paper/2402.03300","citing_paper":"/paper/2608.06013"},"observation_digest":"sha256:cb5d1eafd62636d0cfc855e3d4aa9f9bbb11a90c383cfa2b1380365b954c6f93","observation_id":"9a524563-ce82-4fe7-8e51-e85f3e8a3ca5","resolution":{"observed_at":"2026-08-07T19:27:24.856053Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2505.06685","last_updated":"2025-08-13T07:28:43Z","snapshot_observed_at":"2026-08-20T08:13:18.679971Z","submitted_at":"2025-05-10T16:15:26Z","title":"Emotion-Qwen: A Unified Framework for Emotion and Vision Understanding","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2505.06685","snapshot_observed_at":"2026-08-07T19:27:24.860186Z","title":"Emotion-qwen: Training hybrid experts for uni- fied emotion and general vision-language understanding,","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2608.06013","last_updated":"2026-08-06T13:18:24Z","snapshot_observed_at":"2026-08-17T18:08:51.282644Z","submitted_at":"2026-08-06T13:18:24Z","title":"OneEmo: A Unified Multimodal Reasoning Model for Emotion Perception, Understanding, and Interaction","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-07T19:27:24.860186Z"},"links":{"cited_paper":"/paper/2505.06685","citing_paper":"/paper/2608.06013"},"observation_digest":"sha256:355b2481744646e3e866a2b0cb7c7b2cbbe2ec8fd1c7114c88b6d3bd5ad2c9c7","observation_id":"2f30f774-95af-4147-b937-ac0b6ceffbcd","resolution":{"observed_at":"2026-08-07T19:27:24.860186Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2501.09502","last_updated":"2025-01-16T12:27:05Z","snapshot_observed_at":"2026-08-15T07:02:37.394561Z","submitted_at":"2025-01-16T12:27:05Z","title":"Omni-Emotion: Extending Video MLLM with Detailed Face and Audio Modeling for Multimodal Emotion Analysis","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2501.09502","snapshot_observed_at":"2026-08-07T19:27:24.864589Z","title":"Omni-emotion: Extending video mllm with detailed face and audio modeling for multimodal emotion analysis,","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2608.06013","last_updated":"2026-08-06T13:18:24Z","snapshot_observed_at":"2026-08-17T18:08:51.282644Z","submitted_at":"2026-08-06T13:18:24Z","title":"OneEmo: A Unified Multimodal Reasoning Model for Emotion Perception, Understanding, and Interaction","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-07T19:27:24.864589Z"},"links":{"cited_paper":"/paper/2501.09502","citing_paper":"/paper/2608.06013"},"observation_digest":"sha256:3f33074751a8df6246e7c0e6e457b2e35cba5aa8595d5a4103d1fcb04ab9cb03","observation_id":"40f34a35-0f09-42cf-87c2-002b6151b5ff","resolution":{"observed_at":"2026-08-07T19:27:24.864589Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T19:27:26.304681Z","title":"Merbench: A unified evaluation benchmark for multimodal emotion recognition,","venue":null,"work_id":"f5df5501-5a6b-4020-ab65-1a296e9042a5","year":2026},"citing_paper":{"arxiv_id":"2608.06013","last_updated":"2026-08-06T13:18:24Z","snapshot_observed_at":"2026-08-17T18:08:51.282644Z","submitted_at":"2026-08-06T13:18:24Z","title":"OneEmo: A Unified Multimodal Reasoning Model for Emotion Perception, Understanding, and Interaction","version":1},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-07T19:27:24.868983Z"},"links":{"citing_paper":"/paper/2608.06013"},"observation_digest":"sha256:b8c2ba8e6cf9a20c5e10fea97c64d109ad9a8229ad5fe720f18703581409b4ed","observation_id":"0002cad8-5ac1-41f2-80af-652b7ad246b2","resolution":{"observed_at":"2026-08-07T19:27:26.309416Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T19:27:26.293413Z","title":"Evolutionary multimodal reasoning via hierarchical semantic representation for intent recognition,","venue":null,"work_id":"f4d78c77-a0d2-4104-a73c-26c7464bf4c9","year":2026},"citing_paper":{"arxiv_id":"2608.06013","last_updated":"2026-08-06T13:18:24Z","snapshot_observed_at":"2026-08-17T18:08:51.282644Z","submitted_at":"2026-08-06T13:18:24Z","title":"OneEmo: A Unified Multimodal Reasoning Model for Emotion Perception, Understanding, and Interaction","version":1},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-07T19:27:24.872953Z"},"links":{"citing_paper":"/paper/2608.06013"},"observation_digest":"sha256:e304b85902e27a17fb59c62899868630ac642b599de246f4e2a1065cfa5bdc03","observation_id":"d94f712f-4a34-4a13-b2f3-3a7186abc41d","resolution":{"observed_at":"2026-08-07T19:27:26.297552Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T19:27:26.281790Z","title":"Ecommir: To- wards intelligent multimodal intent recognition in e-commerce dialogue systems,","venue":null,"work_id":"0e899238-769e-4287-964e-19e6ed398ccb","year":2025},"citing_paper":{"arxiv_id":"2608.06013","last_updated":"2026-08-06T13:18:24Z","snapshot_observed_at":"2026-08-17T18:08:51.282644Z","submitted_at":"2026-08-06T13:18:24Z","title":"OneEmo: A Unified Multimodal Reasoning Model for Emotion Perception, Understanding, and Interaction","version":1},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-07T19:27:24.876516Z"},"links":{"citing_paper":"/paper/2608.06013"},"observation_digest":"sha256:85694a6656026beaf6babc18aae22fe10180b0f868380efdbf349a46cb6fe6a2","observation_id":"40fee8ef-9625-44db-adcd-9976b4b8ae8f","resolution":{"observed_at":"2026-08-07T19:27:26.285848Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T19:27:26.270699Z","title":"Emotion-coherent reasoning for multimodal llms via emotional rationale verifier,","venue":null,"work_id":"2df9724d-73b2-499c-9281-efe5906dee45","year":2026},"citing_paper":{"arxiv_id":"2608.06013","last_updated":"2026-08-06T13:18:24Z","snapshot_observed_at":"2026-08-17T18:08:51.282644Z","submitted_at":"2026-08-06T13:18:24Z","title":"OneEmo: A Unified Multimodal Reasoning Model for Emotion Perception, Understanding, and Interaction","version":1},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-07T19:27:24.880688Z"},"links":{"citing_paper":"/paper/2608.06013"},"observation_digest":"sha256:a0c28dd7fc2d7d66664c783f162401658b86378690976be45ef5822bf5ba3567","observation_id":"9c8a0aa0-2a86-4f19-a4ad-bf3839a1c1ed","resolution":{"observed_at":"2026-08-07T19:27:26.274698Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T19:27:26.258389Z","title":"Empathy level alignment via reinforcement learning for empathetic response generation,","venue":null,"work_id":"e081d046-c747-4ed4-865f-10dbb25d1d66","year":2025},"citing_paper":{"arxiv_id":"2608.06013","last_updated":"2026-08-06T13:18:24Z","snapshot_observed_at":"2026-08-17T18:08:51.282644Z","submitted_at":"2026-08-06T13:18:24Z","title":"OneEmo: A Unified Multimodal Reasoning Model for Emotion Perception, Understanding, and Interaction","version":1},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-07T19:27:24.884350Z"},"links":{"citing_paper":"/paper/2608.06013"},"observation_digest":"sha256:093292771481a1f607ff127093722f02129df0b53b91b43b375460465e0a7f74","observation_id":"3270088e-172d-4f7b-95dc-87473dfc8f31","resolution":{"observed_at":"2026-08-07T19:27:26.262325Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T19:27:26.246735Z","title":"Ecr-chain: Advancing generative language models to better emotion-cause reasoners through reasoning chains,","venue":null,"work_id":"854c6c47-9706-4aa9-a1d9-fe882c7689f0","year":2024},"citing_paper":{"arxiv_id":"2608.06013","last_updated":"2026-08-06T13:18:24Z","snapshot_observed_at":"2026-08-17T18:08:51.282644Z","submitted_at":"2026-08-06T13:18:24Z","title":"OneEmo: A Unified Multimodal Reasoning Model for Emotion Perception, Understanding, and Interaction","version":1},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-08-07T19:27:24.887999Z"},"links":{"citing_paper":"/paper/2608.06013"},"observation_digest":"sha256:b87e6cd2035e9a0bd30c01d382db15f4f8653025137e290ac8fe6d76069e0692","observation_id":"45f28e3b-4ba2-4c17-a6ae-9b531f904aec","resolution":{"observed_at":"2026-08-07T19:27:26.250960Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2508.10848","last_updated":"2026-07-20T03:32:44Z","snapshot_observed_at":"2026-08-17T16:25:09.395995Z","submitted_at":"2025-08-14T17:18:35Z","title":"Psyche-R1: Towards Reliable Psychological LLMs through Unified Empathy, Expertise, and Reasoning","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2508.10848","snapshot_observed_at":"2026-08-07T19:27:24.891981Z","title":"Psyche-r1: Towards reliable psychological llms through unified empathy, expertise, and reasoning,","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2608.06013","last_updated":"2026-08-06T13:18:24Z","snapshot_observed_at":"2026-08-17T18:08:51.282644Z","submitted_at":"2026-08-06T13:18:24Z","title":"OneEmo: A Unified Multimodal Reasoning Model for Emotion Perception, Understanding, and Interaction","version":1},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-08-07T19:27:24.891981Z"},"links":{"cited_paper":"/paper/2508.10848","citing_paper":"/paper/2608.06013"},"observation_digest":"sha256:ae84aea2c4a36d5b64c8d11cbaafb4e135b92a4265863d023cc76aaf2575ad66","observation_id":"1f103c31-4885-4185-a61b-f21d837e35d3","resolution":{"observed_at":"2026-08-07T19:27:24.891981Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T19:27:26.236481Z","title":"Dfew: A large-scale database for recognizing dynamic facial expressions in the wild,","venue":null,"work_id":"ffb25f0f-3ca0-4b7c-a934-61da1e2a9cd6","year":2020},"citing_paper":{"arxiv_id":"2608.06013","last_updated":"2026-08-06T13:18:24Z","snapshot_observed_at":"2026-08-17T18:08:51.282644Z","submitted_at":"2026-08-06T13:18:24Z","title":"OneEmo: A Unified Multimodal Reasoning Model for Emotion Perception, Understanding, and Interaction","version":1},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-08-07T19:27:24.896349Z"},"links":{"citing_paper":"/paper/2608.06013"},"observation_digest":"sha256:60d243d43898ab5b3f821761ccd1ae0c66c0e2ef1a5cfe1f6357946f9588de1f","observation_id":"aa9c4233-be00-47c8-a061-2802adc591a2","resolution":{"observed_at":"2026-08-07T19:27:26.239853Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T19:27:26.225236Z","title":"Mer 2025: When affective computing meets large language models,","venue":null,"work_id":"0be6f56d-8bac-4b4f-8a4f-c9009e38e10e","year":2025},"citing_paper":{"arxiv_id":"2608.06013","last_updated":"2026-08-06T13:18:24Z","snapshot_observed_at":"2026-08-17T18:08:51.282644Z","submitted_at":"2026-08-06T13:18:24Z","title":"OneEmo: A Unified Multimodal Reasoning Model for Emotion Perception, Understanding, and Interaction","version":1},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-08-07T19:27:24.899432Z"},"links":{"citing_paper":"/paper/2608.06013"},"observation_digest":"sha256:2c6c926364007282a3ea16537c07c2382e1f97a56738b3a62a419a7772435771","observation_id":"8e1cc816-4d74-4bb0-9773-b73d153d9d73","resolution":{"observed_at":"2026-08-07T19:27:26.229043Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T19:27:26.213175Z","title":"Mintrec: A new dataset for multimodal intent recognition,","venue":null,"work_id":"f9ad778f-b191-4ba4-8abe-2719ed059001","year":2022},"citing_paper":{"arxiv_id":"2608.06013","last_updated":"2026-08-06T13:18:24Z","snapshot_observed_at":"2026-08-17T18:08:51.282644Z","submitted_at":"2026-08-06T13:18:24Z","title":"OneEmo: A Unified Multimodal Reasoning Model for Emotion Perception, Understanding, and Interaction","version":1},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-08-07T19:27:24.902437Z"},"links":{"citing_paper":"/paper/2608.06013"},"observation_digest":"sha256:37b4fa4ec2e22d56342fd6a89b3019acfd0c68a2cfec94c22c38ce6fdf461f3d","observation_id":"3352ba96-cb57-4e7f-9ad2-543360484f7d","resolution":{"observed_at":"2026-08-07T19:27:26.217514Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T19:27:26.201180Z","title":"Mintrec2.0: A large-scale benchmark dataset for multimodal intent recognition and out-of-scope detection in conversations,","venue":null,"work_id":"dcd61564-cfa4-40e2-be2f-10f50c9dfcf2","year":2024},"citing_paper":{"arxiv_id":"2608.06013","last_updated":"2026-08-06T13:18:24Z","snapshot_observed_at":"2026-08-17T18:08:51.282644Z","submitted_at":"2026-08-06T13:18:24Z","title":"OneEmo: A Unified Multimodal Reasoning Model for Emotion Perception, Understanding, and Interaction","version":1},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-08-07T19:27:24.905468Z"},"links":{"citing_paper":"/paper/2608.06013"},"observation_digest":"sha256:a4f3fe42009e2378fbfd17b7c19644048bd5b1eb9a0012543a90b3f67073a580","observation_id":"2e0bcda3-d2b2-4704-a852-71a14c6a32ed","resolution":{"observed_at":"2026-08-07T19:27:26.205627Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T19:27:26.189351Z","title":"Towards multimodal sarcasm detection (an obviously perfect paper),","venue":null,"work_id":"2806fa2c-07df-4b91-b175-719fdfd95f3d","year":2019},"citing_paper":{"arxiv_id":"2608.06013","last_updated":"2026-08-06T13:18:24Z","snapshot_observed_at":"2026-08-17T18:08:51.282644Z","submitted_at":"2026-08-06T13:18:24Z","title":"OneEmo: A Unified Multimodal Reasoning Model for Emotion Perception, Understanding, and Interaction","version":1},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-08-07T19:27:24.908417Z"},"links":{"citing_paper":"/paper/2608.06013"},"observation_digest":"sha256:0d0a876b6b96e809a15a9c0835c72dcd79f4dad24e721211e1dd7a70f45bf767","observation_id":"528bd816-2a74-4b44-98a1-0c84d3c34f89","resolution":{"observed_at":"2026-08-07T19:27:26.193396Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T19:27:26.177258Z","title":"UR-FUNNY: A multimodal lan- guage dataset for understanding humor,","venue":null,"work_id":"ecdedc1e-da89-4278-8f46-6cc7bde42587","year":2019},"citing_paper":{"arxiv_id":"2608.06013","last_updated":"2026-08-06T13:18:24Z","snapshot_observed_at":"2026-08-17T18:08:51.282644Z","submitted_at":"2026-08-06T13:18:24Z","title":"OneEmo: A Unified Multimodal Reasoning Model for Emotion Perception, Understanding, and Interaction","version":1},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-08-07T19:27:24.911998Z"},"links":{"citing_paper":"/paper/2608.06013"},"observation_digest":"sha256:605c33880cfb3ba0b55f70ee2cf2006ef0350221dd3eca39e7f620e2cf67dd20","observation_id":"123f0c90-b5eb-47d9-8c3f-9a269b4363a3","resolution":{"observed_at":"2026-08-07T19:27:26.181593Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T19:27:24.915577Z","title":"Beyond empathy: Integrating diagnostic and therapeutic reasoning with large language models for mental health counseling,","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2608.06013","last_updated":"2026-08-06T13:18:24Z","snapshot_observed_at":"2026-08-17T18:08:51.282644Z","submitted_at":"2026-08-06T13:18:24Z","title":"OneEmo: A Unified Multimodal Reasoning Model for Emotion Perception, Understanding, and Interaction","version":1},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-08-07T19:27:24.915577Z"},"links":{"citing_paper":"/paper/2608.06013"},"observation_digest":"sha256:52ab702708734d78ffa84ffbfe02a608e391474909228537862e4e8dcd306cc6","observation_id":"ec664026-5266-41a8-8062-32d6b1da6984","resolution":{"observed_at":"2026-08-07T19:27:24.915577Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T19:27:26.164893Z","title":"Seed2.0: Towards intelligence frontier for real- world complex tasks,","venue":null,"work_id":"a3a8201b-d1ff-4d6b-a33e-749e553ceddb","year":2026},"citing_paper":{"arxiv_id":"2608.06013","last_updated":"2026-08-06T13:18:24Z","snapshot_observed_at":"2026-08-17T18:08:51.282644Z","submitted_at":"2026-08-06T13:18:24Z","title":"OneEmo: A Unified Multimodal Reasoning Model for Emotion Perception, Understanding, and Interaction","version":1},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-08-07T19:27:24.918952Z"},"links":{"citing_paper":"/paper/2608.06013"},"observation_digest":"sha256:b414f1e2818e52a1ea9fbc39bb747343ac72870431759f7b6437647d45562c6e","observation_id":"5cae0e59-5b30-4014-8408-3b2b64254a2d","resolution":{"observed_at":"2026-08-07T19:27:26.168889Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T19:27:26.153278Z","title":"An argument for basic emotions,","venue":null,"work_id":"efc78829-f002-450d-81c9-c6d9926235af","year":1992},"citing_paper":{"arxiv_id":"2608.06013","last_updated":"2026-08-06T13:18:24Z","snapshot_observed_at":"2026-08-17T18:08:51.282644Z","submitted_at":"2026-08-06T13:18:24Z","title":"OneEmo: A Unified Multimodal Reasoning Model for Emotion Perception, Understanding, and Interaction","version":1},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-08-07T19:27:24.922619Z"},"links":{"citing_paper":"/paper/2608.06013"},"observation_digest":"sha256:439574d679d0bb29f21a6dd5e4372ea99e5feca832f06364359e33ae307b4bb3","observation_id":"f63227b0-a66f-4390-a6e0-d083d58252cb","resolution":{"observed_at":"2026-08-07T19:27:26.157343Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T19:27:26.140903Z","title":"A two-stage model for the appreciation of jokes and cartoons: An information-processing analysis,","venue":null,"work_id":"bd5f2852-9389-4e6e-9a3c-775a417860c7","year":1972},"citing_paper":{"arxiv_id":"2608.06013","last_updated":"2026-08-06T13:18:24Z","snapshot_observed_at":"2026-08-17T18:08:51.282644Z","submitted_at":"2026-08-06T13:18:24Z","title":"OneEmo: A Unified Multimodal Reasoning Model for Emotion Perception, Understanding, and Interaction","version":1},"reference_index":36,"source":"pdf_text","source_observed_at":"2026-08-07T19:27:24.926493Z"},"links":{"citing_paper":"/paper/2608.06013"},"observation_digest":"sha256:efdc10fd5edcb13d49ba53e4b16f9e23617583737d99728f8d80389e303f20b4","observation_id":"ec4170fe-0523-4141-92ed-53c1ac333ab1","resolution":{"observed_at":"2026-08-07T19:27:26.145371Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T19:27:26.129855Z","title":null,"venue":null,"work_id":"ca1dabb7-67d3-493f-88e7-e6b9ee21efdf","year":1972},"citing_paper":{"arxiv_id":"2608.06013","last_updated":"2026-08-06T13:18:24Z","snapshot_observed_at":"2026-08-17T18:08:51.282644Z","submitted_at":"2026-08-06T13:18:24Z","title":"OneEmo: A Unified Multimodal Reasoning Model for Emotion Perception, Understanding, and Interaction","version":1},"reference_index":37,"source":"pdf_text","source_observed_at":"2026-08-07T19:27:24.929880Z"},"links":{"citing_paper":"/paper/2608.06013"},"observation_digest":"sha256:d3092ee90466778f7e7ef9a62caacf3c0e487e1aa6d0acc58af04070a135dec2","observation_id":"cda8d6bb-b7f3-46eb-8403-d6330a3547e7","resolution":{"observed_at":"2026-08-07T19:27:26.133445Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T19:27:26.119374Z","title":"On the pretense theory of irony,","venue":null,"work_id":"54229061-721d-4507-a2d1-864af432eb36","year":1984},"citing_paper":{"arxiv_id":"2608.06013","last_updated":"2026-08-06T13:18:24Z","snapshot_observed_at":"2026-08-17T18:08:51.282644Z","submitted_at":"2026-08-06T13:18:24Z","title":"OneEmo: A Unified Multimodal Reasoning Model for Emotion Perception, Understanding, and Interaction","version":1},"reference_index":38,"source":"pdf_text","source_observed_at":"2026-08-07T19:27:24.933376Z"},"links":{"citing_paper":"/paper/2608.06013"},"observation_digest":"sha256:5593cdb76211a3868e4e2190705a9296e1d25c61e5791001009b56495a811560","observation_id":"767a44cc-fae9-4b18-a728-d6a866fe4f65","resolution":{"observed_at":"2026-08-07T19:27:26.122575Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T19:27:24.936886Z","title":null,"venue":null,"work_id":null,"year":1991},"citing_paper":{"arxiv_id":"2608.06013","last_updated":"2026-08-06T13:18:24Z","snapshot_observed_at":"2026-08-17T18:08:51.282644Z","submitted_at":"2026-08-06T13:18:24Z","title":"OneEmo: A Unified Multimodal Reasoning Model for Emotion Perception, Understanding, and Interaction","version":1},"reference_index":39,"source":"pdf_text","source_observed_at":"2026-08-07T19:27:24.936886Z"},"links":{"citing_paper":"/paper/2608.06013"},"observation_digest":"sha256:c702ca3aa983f138481825d68c94afcb246b033a0dc323967e84c73bf998e051","observation_id":"a2354324-5b21-4f28-9615-e70ac846a200","resolution":{"observed_at":"2026-08-07T19:27:24.936886Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T19:27:26.100795Z","title":"Washington, DC: American Psychiatric Association Publishing, 2013","venue":null,"work_id":"7e50b7c2-1fdf-4cc6-bb85-50d29cc1bde5","year":2013},"citing_paper":{"arxiv_id":"2608.06013","last_updated":"2026-08-06T13:18:24Z","snapshot_observed_at":"2026-08-17T18:08:51.282644Z","submitted_at":"2026-08-06T13:18:24Z","title":"OneEmo: A Unified Multimodal Reasoning Model for Emotion Perception, Understanding, and Interaction","version":1},"reference_index":40,"source":"pdf_text","source_observed_at":"2026-08-07T19:27:24.940678Z"},"links":{"citing_paper":"/paper/2608.06013"},"observation_digest":"sha256:5f967687395d3327e0e9e6b9db7ef89d11d590e9764d8559dd71e66644122935","observation_id":"b4132aed-2d6a-4be3-a48b-3d3d80217b2a","resolution":{"observed_at":"2026-08-07T19:27:26.104843Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T19:27:26.087988Z","title":"Geneva, Switzerland: World Health Organization, 2022","venue":null,"work_id":"31a6ec25-216f-4200-85f3-245b8e361d47","year":2022},"citing_paper":{"arxiv_id":"2608.06013","last_updated":"2026-08-06T13:18:24Z","snapshot_observed_at":"2026-08-17T18:08:51.282644Z","submitted_at":"2026-08-06T13:18:24Z","title":"OneEmo: A Unified Multimodal Reasoning Model for Emotion Perception, Understanding, and Interaction","version":1},"reference_index":41,"source":"pdf_text","source_observed_at":"2026-08-07T19:27:24.944858Z"},"links":{"citing_paper":"/paper/2608.06013"},"observation_digest":"sha256:74ec225998b2307706b96d0006cda8846cfc26ddda52596a04a551751de5f122","observation_id":"216c8297-50b0-481a-8104-1d6b0c106cd8","resolution":{"observed_at":"2026-08-07T19:27:26.093079Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T19:27:26.076463Z","title":null,"venue":null,"work_id":"e43c1255-c3db-4394-89ee-7e92925a09dd","year":1976},"citing_paper":{"arxiv_id":"2608.06013","last_updated":"2026-08-06T13:18:24Z","snapshot_observed_at":"2026-08-17T18:08:51.282644Z","submitted_at":"2026-08-06T13:18:24Z","title":"OneEmo: A Unified Multimodal Reasoning Model for Emotion Perception, Understanding, and Interaction","version":1},"reference_index":42,"source":"pdf_text","source_observed_at":"2026-08-07T19:27:24.948517Z"},"links":{"citing_paper":"/paper/2608.06013"},"observation_digest":"sha256:22963cf93ffaadefea35be898c8c996f95a101aa25880f17371201c2e304d3f0","observation_id":"9ec15474-3cfa-447b-8287-00cf09520086","resolution":{"observed_at":"2026-08-07T19:27:26.080334Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T19:27:26.064494Z","title":null,"venue":null,"work_id":"2e8b5cac-228b-43e9-8a65-adb37bc94407","year":1999},"citing_paper":{"arxiv_id":"2608.06013","last_updated":"2026-08-06T13:18:24Z","snapshot_observed_at":"2026-08-17T18:08:51.282644Z","submitted_at":"2026-08-06T13:18:24Z","title":"OneEmo: A Unified Multimodal Reasoning Model for Emotion Perception, Understanding, and Interaction","version":1},"reference_index":43,"source":"pdf_text","source_observed_at":"2026-08-07T19:27:24.952581Z"},"links":{"citing_paper":"/paper/2608.06013"},"observation_digest":"sha256:89c68d81efb83bf8ef20e287e84084f6c6181b6f3f97b2e1312026e2345ba1be","observation_id":"d15e1214-f37d-43b3-aa21-a3a26b61aab0","resolution":{"observed_at":"2026-08-07T19:27:26.069109Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T19:27:24.956795Z","title":"On-policy rl meets off-policy experts: Harmonizing supervised fine-tuning and reinforcement learning via dynamic weighting,","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2608.06013","last_updated":"2026-08-06T13:18:24Z","snapshot_observed_at":"2026-08-17T18:08:51.282644Z","submitted_at":"2026-08-06T13:18:24Z","title":"OneEmo: A Unified Multimodal Reasoning Model for Emotion Perception, Understanding, and Interaction","version":1},"reference_index":44,"source":"pdf_text","source_observed_at":"2026-08-07T19:27:24.956795Z"},"links":{"citing_paper":"/paper/2608.06013"},"observation_digest":"sha256:478e454f9efa65d2d7abee06236c20e5c311a29674ecb9862f0fb87717f6f00c","observation_id":"278ad646-ada4-4c5a-9253-e55e595b01cf","resolution":{"observed_at":"2026-08-07T19:27:24.956795Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T19:27:26.053191Z","title":"Sentence-BERT: Sentence embeddings using Siamese BERT-networks,","venue":null,"work_id":"c3c996a5-f965-43a8-8f56-be8d2e9f7676","year":2019},"citing_paper":{"arxiv_id":"2608.06013","last_updated":"2026-08-06T13:18:24Z","snapshot_observed_at":"2026-08-17T18:08:51.282644Z","submitted_at":"2026-08-06T13:18:24Z","title":"OneEmo: A Unified Multimodal Reasoning Model for Emotion Perception, Understanding, and Interaction","version":1},"reference_index":45,"source":"pdf_text","source_observed_at":"2026-08-07T19:27:24.960993Z"},"links":{"citing_paper":"/paper/2608.06013"},"observation_digest":"sha256:3b2280e9ce17979610d8bc7ec2514e8016ff3a961213d6edf4c23b3a027f9de2","observation_id":"c7941c7f-e446-440c-b62e-71de8ea94d4e","resolution":{"observed_at":"2026-08-07T19:27:26.057210Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T19:27:26.040845Z","title":"Mosi: Multimodal corpus of sentiment intensity and subjectivity analysis in online opinion videos,","venue":null,"work_id":"b632a5b0-e73f-4359-ae50-56df8a3b54d8","year":2016},"citing_paper":{"arxiv_id":"2608.06013","last_updated":"2026-08-06T13:18:24Z","snapshot_observed_at":"2026-08-17T18:08:51.282644Z","submitted_at":"2026-08-06T13:18:24Z","title":"OneEmo: A Unified Multimodal Reasoning Model for Emotion Perception, Understanding, and Interaction","version":1},"reference_index":46,"source":"pdf_text","source_observed_at":"2026-08-07T19:27:24.965094Z"},"links":{"citing_paper":"/paper/2608.06013"},"observation_digest":"sha256:a17bac5b151d27697a00ef62ed072d4aaf51c602e8f706ee58c299e9c6bf7306","observation_id":"16e86cf0-e68c-453f-8986-353057da093f","resolution":{"observed_at":"2026-08-07T19:27:26.044999Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T19:27:26.028065Z","title":"Multimodal language analysis in the wild: Cmu-mosei dataset and interpretable dynamic fusion graph,","venue":null,"work_id":"8dbdfb64-cbd3-49d9-a9fb-a8adcde571bd","year":2018},"citing_paper":{"arxiv_id":"2608.06013","last_updated":"2026-08-06T13:18:24Z","snapshot_observed_at":"2026-08-17T18:08:51.282644Z","submitted_at":"2026-08-06T13:18:24Z","title":"OneEmo: A Unified Multimodal Reasoning Model for Emotion Perception, Understanding, and Interaction","version":1},"reference_index":47,"source":"pdf_text","source_observed_at":"2026-08-07T19:27:24.969089Z"},"links":{"citing_paper":"/paper/2608.06013"},"observation_digest":"sha256:9ee23f1d2ab888d580b5eb9629d1a4f47d5228fd66d5ea6f091cc233f86ecbcf","observation_id":"db1cf503-d98c-42c8-9108-95891ec46602","resolution":{"observed_at":"2026-08-07T19:27:26.032531Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T19:27:26.015635Z","title":"Ch- sims: A chinese multimodal sentiment analysis dataset with fine-grained annotation of modality,","venue":null,"work_id":"5dcee0ca-5676-45a2-a5ce-b9a121f58c61","year":2020},"citing_paper":{"arxiv_id":"2608.06013","last_updated":"2026-08-06T13:18:24Z","snapshot_observed_at":"2026-08-17T18:08:51.282644Z","submitted_at":"2026-08-06T13:18:24Z","title":"OneEmo: A Unified Multimodal Reasoning Model for Emotion Perception, Understanding, and Interaction","version":1},"reference_index":48,"source":"pdf_text","source_observed_at":"2026-08-07T19:27:24.973053Z"},"links":{"citing_paper":"/paper/2608.06013"},"observation_digest":"sha256:a2a6585100d3b0d35d3c8eb89e27cba6afd3e08c7c9c7876b66fd6688e2b226a","observation_id":"f1173df1-c60b-4941-841b-222d641e7c61","resolution":{"observed_at":"2026-08-07T19:27:26.019772Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T19:27:26.003652Z","title":"Make acoustic and visual cues matter: Ch-sims v2. 0 dataset and av-mixup consistent module,","venue":null,"work_id":"170f0dc4-b63c-4d83-8887-983dd323c83d","year":2022},"citing_paper":{"arxiv_id":"2608.06013","last_updated":"2026-08-06T13:18:24Z","snapshot_observed_at":"2026-08-17T18:08:51.282644Z","submitted_at":"2026-08-06T13:18:24Z","title":"OneEmo: A Unified Multimodal Reasoning Model for Emotion Perception, Understanding, and Interaction","version":1},"reference_index":49,"source":"pdf_text","source_observed_at":"2026-08-07T19:27:24.977188Z"},"links":{"citing_paper":"/paper/2608.06013"},"observation_digest":"sha256:a24c064cbe520f88f4fae9d95b5d9ce3b1d73512fff27c1ce568959ce863fa7a","observation_id":"c17fedce-9ad2-44b0-ac95-4470bc6ef50a","resolution":{"observed_at":"2026-08-07T19:27:26.007936Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T19:27:25.992459Z","title":"Mer 2023: Multi-label learning, modality robustness, and semi-supervised learning,","venue":null,"work_id":"4b057b3a-8c1a-4626-8d99-55182bd6b857","year":2023},"citing_paper":{"arxiv_id":"2608.06013","last_updated":"2026-08-06T13:18:24Z","snapshot_observed_at":"2026-08-17T18:08:51.282644Z","submitted_at":"2026-08-06T13:18:24Z","title":"OneEmo: A Unified Multimodal Reasoning Model for Emotion Perception, Understanding, and Interaction","version":1},"reference_index":50,"source":"pdf_text","source_observed_at":"2026-08-07T19:27:24.980838Z"},"links":{"citing_paper":"/paper/2608.06013"},"observation_digest":"sha256:b9f23f51a6e29c87d1791d15da388f8861c7d59893d945557498c8f9d93b8d53","observation_id":"e45d6aab-bb7b-4355-ad49-2b06331c0d60","resolution":{"observed_at":"2026-08-07T19:27:25.995866Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T19:27:25.981599Z","title":"Mer 2024: Semi-supervised learning, noise robustness, and open-vocabulary multimodal emotion recognition,","venue":null,"work_id":"3cc3ca8a-7b8f-4bf2-811a-98d6354a4e71","year":2024},"citing_paper":{"arxiv_id":"2608.06013","last_updated":"2026-08-06T13:18:24Z","snapshot_observed_at":"2026-08-17T18:08:51.282644Z","submitted_at":"2026-08-06T13:18:24Z","title":"OneEmo: A Unified Multimodal Reasoning Model for Emotion Perception, Understanding, and Interaction","version":1},"reference_index":51,"source":"pdf_text","source_observed_at":"2026-08-07T19:27:24.984795Z"},"links":{"citing_paper":"/paper/2608.06013"},"observation_digest":"sha256:d8943a80cfcf8c466da88c84d279108902cae872db5619fae694ba00043cda0a","observation_id":"74c14624-f3d8-4a84-b851-cdc43ab96b3f","resolution":{"observed_at":"2026-08-07T19:27:25.985112Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T19:27:25.970976Z","title":"MELD: A multimodal multi-party dataset for emotion recognition in conversations,","venue":null,"work_id":"30d411e7-ce13-4d84-b35e-647494580bea","year":2019},"citing_paper":{"arxiv_id":"2608.06013","last_updated":"2026-08-06T13:18:24Z","snapshot_observed_at":"2026-08-17T18:08:51.282644Z","submitted_at":"2026-08-06T13:18:24Z","title":"OneEmo: A Unified Multimodal Reasoning Model for Emotion Perception, Understanding, and Interaction","version":1},"reference_index":52,"source":"pdf_text","source_observed_at":"2026-08-07T19:27:24.988046Z"},"links":{"citing_paper":"/paper/2608.06013"},"observation_digest":"sha256:d90c00e135a267c013c3293fe91c1d0b35432b18d8b3b974258bae8cbcafdfe4","observation_id":"f15c394e-59f0-4c0d-a6c2-37b155c33c25","resolution":{"observed_at":"2026-08-07T19:27:25.974419Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T19:27:24.991931Z","title":"Iemocap: Interactive emotional dyadic motion capture database,","venue":null,"work_id":null,"year":2008},"citing_paper":{"arxiv_id":"2608.06013","last_updated":"2026-08-06T13:18:24Z","snapshot_observed_at":"2026-08-17T18:08:51.282644Z","submitted_at":"2026-08-06T13:18:24Z","title":"OneEmo: A Unified Multimodal Reasoning Model for Emotion Perception, Understanding, and Interaction","version":1},"reference_index":53,"source":"pdf_text","source_observed_at":"2026-08-07T19:27:24.991931Z"},"links":{"citing_paper":"/paper/2608.06013"},"observation_digest":"sha256:edecd47e14c9839ca3efe4edcf4dd1cc2fc43e5ff858225901d6a338275d0fde","observation_id":"1ec2e407-17f8-477e-bb10-879f001d7112","resolution":{"observed_at":"2026-08-07T19:27:24.991931Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T19:27:25.952536Z","title":"Ov-mer: Towards open-vocabulary multimodal emotion recognition,","venue":null,"work_id":"d6071984-ed68-43a1-8d84-2ae07576304b","year":2025},"citing_paper":{"arxiv_id":"2608.06013","last_updated":"2026-08-06T13:18:24Z","snapshot_observed_at":"2026-08-17T18:08:51.282644Z","submitted_at":"2026-08-06T13:18:24Z","title":"OneEmo: A Unified Multimodal Reasoning Model for Emotion Perception, Understanding, and Interaction","version":1},"reference_index":54,"source":"pdf_text","source_observed_at":"2026-08-07T19:27:24.995773Z"},"links":{"citing_paper":"/paper/2608.06013"},"observation_digest":"sha256:5e6f0fee8874830cb81db0ce4f0f4b2869f13986e9b6cc014c12079a9c0beb44","observation_id":"abdee1c9-c765-49fd-a7fd-276d0bbb1b00","resolution":{"observed_at":"2026-08-07T19:27:25.956275Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2408.01800","last_updated":"2024-08-03T15:02:21Z","snapshot_observed_at":"2026-08-21T07:48:51.700518Z","submitted_at":"2024-08-03T15:02:21Z","title":"MiniCPM-V: A GPT-4V Level MLLM on Your Phone","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2408.01800","snapshot_observed_at":"2026-08-07T19:27:24.999419Z","title":"Minicpm-v: A gpt-4v level mllm on your phone,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2608.06013","last_updated":"2026-08-06T13:18:24Z","snapshot_observed_at":"2026-08-17T18:08:51.282644Z","submitted_at":"2026-08-06T13:18:24Z","title":"OneEmo: A Unified Multimodal Reasoning Model for Emotion Perception, Understanding, and Interaction","version":1},"reference_index":55,"source":"pdf_text","source_observed_at":"2026-08-07T19:27:24.999419Z"},"links":{"cited_paper":"/paper/2408.01800","citing_paper":"/paper/2608.06013"},"observation_digest":"sha256:1ecb72c80a012abbcec461b45827b9adedd93b16454d847437f0a177f045c0e1","observation_id":"79744e17-a279-4894-bc30-f0ffd47c2dd8","resolution":{"observed_at":"2026-08-07T19:27:24.999419Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2508.18265","last_updated":"2025-08-27T14:39:45Z","snapshot_observed_at":"2026-08-17T12:32:16.575866Z","submitted_at":"2025-08-25T17:58:17Z","title":"InternVL3.5: Advancing Open-Source Multimodal Models in Versatility, Reasoning, and Efficiency","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2508.18265","snapshot_observed_at":"2026-08-07T19:27:25.004027Z","title":"Internvl3.5: Advancing open-source multi- modal models in versatility, reasoning, and efficiency,","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2608.06013","last_updated":"2026-08-06T13:18:24Z","snapshot_observed_at":"2026-08-17T18:08:51.282644Z","submitted_at":"2026-08-06T13:18:24Z","title":"OneEmo: A Unified Multimodal Reasoning Model for Emotion Perception, Understanding, and Interaction","version":1},"reference_index":56,"source":"pdf_text","source_observed_at":"2026-08-07T19:27:25.004027Z"},"links":{"cited_paper":"/paper/2508.18265","citing_paper":"/paper/2608.06013"},"observation_digest":"sha256:9c407fda90bcc93d0d875f7be72e0b35a5b5aaf469ba970e574e6c7160b96859","observation_id":"c2c19d51-d9f2-4e61-93d9-bdb62d984f36","resolution":{"observed_at":"2026-08-07T19:27:25.004027Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T19:27:25.940488Z","title":"Qwen3.5: Towards native multimodal agents,","venue":null,"work_id":"464be636-7f51-42e5-807c-eb59d55704bf","year":2026},"citing_paper":{"arxiv_id":"2608.06013","last_updated":"2026-08-06T13:18:24Z","snapshot_observed_at":"2026-08-17T18:08:51.282644Z","submitted_at":"2026-08-06T13:18:24Z","title":"OneEmo: A Unified Multimodal Reasoning Model for Emotion Perception, Understanding, and Interaction","version":1},"reference_index":57,"source":"pdf_text","source_observed_at":"2026-08-07T19:27:25.008373Z"},"links":{"citing_paper":"/paper/2608.06013"},"observation_digest":"sha256:91387049b823f786e079110eb0f63adbcf750513a290642908f03338562b044c","observation_id":"aaae876e-7b4c-4edc-9a07-5da4178fdb41","resolution":{"observed_at":"2026-08-07T19:27:25.944696Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2502.13923","last_updated":"2025-02-19T18:00:14Z","snapshot_observed_at":"2026-08-21T16:02:41.546193Z","submitted_at":"2025-02-19T18:00:14Z","title":"Qwen2.5-VL Technical Report","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2502.13923","snapshot_observed_at":"2026-08-07T19:27:25.012368Z","title":"Qwen2.5-vl technical report,","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2608.06013","last_updated":"2026-08-06T13:18:24Z","snapshot_observed_at":"2026-08-17T18:08:51.282644Z","submitted_at":"2026-08-06T13:18:24Z","title":"OneEmo: A Unified Multimodal Reasoning Model for Emotion Perception, Understanding, and Interaction","version":1},"reference_index":58,"source":"pdf_text","source_observed_at":"2026-08-07T19:27:25.012368Z"},"links":{"cited_paper":"/paper/2502.13923","citing_paper":"/paper/2608.06013"},"observation_digest":"sha256:241f84a2ca0ac67538be0946e5bccc60cccb382342bc8d00d601a1a967673d5a","observation_id":"02d6f19e-37d8-44f5-87ab-a9af276acf03","resolution":{"observed_at":"2026-08-07T19:27:25.012368Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2511.21631","last_updated":"2025-11-27T12:16:54Z","snapshot_observed_at":"2026-08-17T13:26:10.378579Z","submitted_at":"2025-11-26T17:59:08Z","title":"Qwen3-VL Technical Report","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2511.21631","snapshot_observed_at":"2026-08-07T19:27:25.016728Z","title":"Qwen3-vl technical report,","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2608.06013","last_updated":"2026-08-06T13:18:24Z","snapshot_observed_at":"2026-08-17T18:08:51.282644Z","submitted_at":"2026-08-06T13:18:24Z","title":"OneEmo: A Unified Multimodal Reasoning Model for Emotion Perception, Understanding, and Interaction","version":1},"reference_index":59,"source":"pdf_text","source_observed_at":"2026-08-07T19:27:25.016728Z"},"links":{"cited_paper":"/paper/2511.21631","citing_paper":"/paper/2608.06013"},"observation_digest":"sha256:e744dc82538b550f70830c839fed848330c430b93771b51ccbd2d4950fb1cd66","observation_id":"019528c1-7e94-4698-86ea-5ad52f87cd1c","resolution":{"observed_at":"2026-08-07T19:27:25.016728Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2606.02800","last_updated":"2026-06-23T17:33:32Z","snapshot_observed_at":"2026-07-06T23:43:07.940839Z","submitted_at":"2026-06-01T19:12:30Z","title":"Cosmos 3: Omnimodal World Models for Physical AI","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2606.02800","snapshot_observed_at":"2026-08-07T19:27:25.020729Z","title":"Cosmos 3: Omnimodal world models for physical ai,","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2608.06013","last_updated":"2026-08-06T13:18:24Z","snapshot_observed_at":"2026-08-17T18:08:51.282644Z","submitted_at":"2026-08-06T13:18:24Z","title":"OneEmo: A Unified Multimodal Reasoning Model for Emotion Perception, Understanding, and Interaction","version":1},"reference_index":60,"source":"pdf_text","source_observed_at":"2026-08-07T19:27:25.020729Z"},"links":{"cited_paper":"/paper/2606.02800","citing_paper":"/paper/2608.06013"},"observation_digest":"sha256:de56711f6dfb621e0a9e28705ada3a37a5e9c6741553153c15fa96d6925c5009","observation_id":"f93d8bf6-d09e-438f-9968-603c8bb60f13","resolution":{"observed_at":"2026-08-07T19:27:25.020729Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T19:27:25.927344Z","title":"Gpt-5 system card,","venue":null,"work_id":"bad3eb85-8b79-4b31-a9f9-22c20c18fd02","year":2025},"citing_paper":{"arxiv_id":"2608.06013","last_updated":"2026-08-06T13:18:24Z","snapshot_observed_at":"2026-08-17T18:08:51.282644Z","submitted_at":"2026-08-06T13:18:24Z","title":"OneEmo: A Unified Multimodal Reasoning Model for Emotion Perception, Understanding, and Interaction","version":1},"reference_index":61,"source":"pdf_text","source_observed_at":"2026-08-07T19:27:25.024851Z"},"links":{"citing_paper":"/paper/2608.06013"},"observation_digest":"sha256:7c49e7d4a926867229c2aa5eafdbfd9ad938c991a015711e6787f527a1cc62d9","observation_id":"c5c0d69b-e4cc-4cc1-9551-6c2aa95cb644","resolution":{"observed_at":"2026-08-07T19:27:25.932517Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T19:27:25.915797Z","title":"Gemini 3.1 pro: A smarter model for your most complex tasks,","venue":null,"work_id":"1653cc66-b461-4600-9d6e-448a396a7050","year":2026},"citing_paper":{"arxiv_id":"2608.06013","last_updated":"2026-08-06T13:18:24Z","snapshot_observed_at":"2026-08-17T18:08:51.282644Z","submitted_at":"2026-08-06T13:18:24Z","title":"OneEmo: A Unified Multimodal Reasoning Model for Emotion Perception, Understanding, and Interaction","version":1},"reference_index":62,"source":"pdf_text","source_observed_at":"2026-08-07T19:27:25.029514Z"},"links":{"citing_paper":"/paper/2608.06013"},"observation_digest":"sha256:ef5f7138677cf49efbd97b8633173541129b18ceac974f74c44585ad8f103126","observation_id":"8eeb08d1-ad47-43b9-a7f4-8a0ddce3ad15","resolution":{"observed_at":"2026-08-07T19:27:25.919719Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T19:27:25.904004Z","title":"Mimo-v2.5-pro: Model card,","venue":null,"work_id":"c8ec53bb-01d5-4e3d-9ee5-44a2d1ae9a04","year":2026},"citing_paper":{"arxiv_id":"2608.06013","last_updated":"2026-08-06T13:18:24Z","snapshot_observed_at":"2026-08-17T18:08:51.282644Z","submitted_at":"2026-08-06T13:18:24Z","title":"OneEmo: A Unified Multimodal Reasoning Model for Emotion Perception, Understanding, and Interaction","version":1},"reference_index":63,"source":"pdf_text","source_observed_at":"2026-08-07T19:27:25.033329Z"},"links":{"citing_paper":"/paper/2608.06013"},"observation_digest":"sha256:5662421db81d39d17bc4177d59f0cc4ede1093546f415ad42868fa10455da7dd","observation_id":"8793c89c-59e8-4c73-8e43-5a45d5893af1","resolution":{"observed_at":"2026-08-07T19:27:25.908078Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T19:27:25.891098Z","title":"Cem: Commonsense-aware empathetic response generation,","venue":null,"work_id":"aebe03ff-e929-440f-9f06-5cba3146c063","year":2022},"citing_paper":{"arxiv_id":"2608.06013","last_updated":"2026-08-06T13:18:24Z","snapshot_observed_at":"2026-08-17T18:08:51.282644Z","submitted_at":"2026-08-06T13:18:24Z","title":"OneEmo: A Unified Multimodal Reasoning Model for Emotion Perception, Understanding, and Interaction","version":1},"reference_index":64,"source":"pdf_text","source_observed_at":"2026-08-07T19:27:25.037345Z"},"links":{"citing_paper":"/paper/2608.06013"},"observation_digest":"sha256:1035afb6f9f882039002e42a9d46b8ec4122d3b6ebc1644ef7c47dec6a533165","observation_id":"5880ca37-f999-4dc4-87a3-8133d208a614","resolution":{"observed_at":"2026-08-07T19:27:25.895547Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T19:27:25.878656Z","title":"ESC-eval: Evaluating emotion support conversations in large language models,","venue":null,"work_id":"1135f2d2-21a5-4247-b0d1-523e9b5d37b5","year":2024},"citing_paper":{"arxiv_id":"2608.06013","last_updated":"2026-08-06T13:18:24Z","snapshot_observed_at":"2026-08-17T18:08:51.282644Z","submitted_at":"2026-08-06T13:18:24Z","title":"OneEmo: A Unified Multimodal Reasoning Model for Emotion Perception, Understanding, and Interaction","version":1},"reference_index":65,"source":"pdf_text","source_observed_at":"2026-08-07T19:27:25.041962Z"},"links":{"citing_paper":"/paper/2608.06013"},"observation_digest":"sha256:7a457b76083cdce796a253eba6ef50ed49235f2c025d4dfc7f2c4809b790c52f","observation_id":"bcbb15a2-a32e-47ed-ad30-32e0dd93811a","resolution":{"observed_at":"2026-08-07T19:27:25.882879Z","resolver_source":"raw_fallback","status":"malformed_identifier"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T19:27:25.865727Z","title":"Penalize fabricated observations, invented events, or contradictions","venue":null,"work_id":"fba74537-81d4-4416-b0f6-0e7426dbfd11","year":null},"citing_paper":{"arxiv_id":"2608.06013","last_updated":"2026-08-06T13:18:24Z","snapshot_observed_at":"2026-08-17T18:08:51.282644Z","submitted_at":"2026-08-06T13:18:24Z","title":"OneEmo: A Unified Multimodal Reasoning Model for Emotion Perception, Understanding, and Interaction","version":1},"reference_index":66,"source":"pdf_text","source_observed_at":"2026-08-07T19:27:25.047120Z"},"links":{"citing_paper":"/paper/2608.06013"},"observation_digest":"sha256:73d173ed466ddc5ad2f610b312cf8aa0d0c796af57c813f501d5add096f413ff","observation_id":"d277087e-641b-4fdd-8e6e-53328486c43e","resolution":{"observed_at":"2026-08-07T19:27:25.869991Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T19:27:25.852275Z","title":"The answer must naturally follow from the reasoning (convergence for single-label; logical support for open-label)","venue":null,"work_id":"e99dfb02-2841-432b-90e5-72f7e0b7e486","year":null},"citing_paper":{"arxiv_id":"2608.06013","last_updated":"2026-08-06T13:18:24Z","snapshot_observed_at":"2026-08-17T18:08:51.282644Z","submitted_at":"2026-08-06T13:18:24Z","title":"OneEmo: A Unified Multimodal Reasoning Model for Emotion Perception, Understanding, and Interaction","version":1},"reference_index":67,"source":"pdf_text","source_observed_at":"2026-08-07T19:27:25.052330Z"},"links":{"citing_paper":"/paper/2608.06013"},"observation_digest":"sha256:3f1c7e5317561c91a21c6ec3606e87d44b901bdee5c69d63e4e1ba759e573756","observation_id":"ec001f20-c85a-40f1-866b-862af932c459","resolution":{"observed_at":"2026-08-07T19:27:25.857198Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T19:27:25.838502Z","title":"Focus on capturing the user’s situation, emotional state, core conflict, needs, and drivers","venue":null,"work_id":"b6594cae-c0c9-4907-886e-eb9010af8c8b","year":null},"citing_paper":{"arxiv_id":"2608.06013","last_updated":"2026-08-06T13:18:24Z","snapshot_observed_at":"2026-08-17T18:08:51.282644Z","submitted_at":"2026-08-06T13:18:24Z","title":"OneEmo: A Unified Multimodal Reasoning Model for Emotion Perception, Understanding, and Interaction","version":1},"reference_index":68,"source":"pdf_text","source_observed_at":"2026-08-07T19:27:25.056596Z"},"links":{"citing_paper":"/paper/2608.06013"},"observation_digest":"sha256:8de0d6e84b8574363eb864e5c8b986e7ebd6bf2e3d4f06437ee7a08dc65c9ad5","observation_id":"b6738bf5-5ef8-49cc-85e1-209ab2d0bfc4","resolution":{"observed_at":"2026-08-07T19:27:25.843501Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T19:27:25.825954Z","title":"I’m sorry to hear that","venue":null,"work_id":"d3babe02-8b58-4abc-a08b-ef1799344efd","year":2021},"citing_paper":{"arxiv_id":"2608.06013","last_updated":"2026-08-06T13:18:24Z","snapshot_observed_at":"2026-08-17T18:08:51.282644Z","submitted_at":"2026-08-06T13:18:24Z","title":"OneEmo: A Unified Multimodal Reasoning Model for Emotion Perception, Understanding, and Interaction","version":1},"reference_index":69,"source":"pdf_text","source_observed_at":"2026-08-07T19:27:25.060586Z"},"links":{"citing_paper":"/paper/2608.06013"},"observation_digest":"sha256:7237b6e6775baae8c460c4a2102fb0fc371a23c074e2d9dee2fc61355bb770e8","observation_id":"0f5a8007-fa9c-4adc-b05c-98d407fd2623","resolution":{"observed_at":"2026-08-07T19:27:25.830832Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}}],"paper":{"arxiv_id":"2608.06013","last_updated":"2026-08-06T13:18:24Z","latest_version":1,"primary_category":"cs.HC","snapshot_observed_at":"2026-08-17T18:08:51.282644Z","submitted_at":"2026-08-06T13:18:24Z","title":"OneEmo: A Unified Multimodal Reasoning Model for Emotion Perception, Understanding, and Interaction"},"reference_resolution":{"displayed":69,"state_counts":{"malformed_identifier":1,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":19,"verified_exact":0,"verified_fuzzy":49},"total_outbound_references":69},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"thesis":"As of 22 August 2026, this Paper Citation Record lists 69 of 69 outbound references and 0 inbound Pith citation observations for arXiv:2608.06013."}