{"as_of":"2026-08-09T15:16:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:39c44e968e610e4fdaa92581ab5971a2fac1c8acaa9726d6eecb5904bf0bfdd9","coverage":[{"denominator":37,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":37,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-01T18:16:52.159711Z","state":"measured"},{"denominator":38,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":38,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-09T06:31:02.800959+00:00","state":"measured"},{"denominator":1,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":1,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-01T18:16:47.824858Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2607.17366","last_updated":"2026-07-19T18:09:54Z","snapshot_observed_at":"2026-08-09T09:33:01.501071Z","submitted_at":"2026-07-19T18:09:54Z","title":"EII-SCL: Harnessing Emotional Inertia for Multimodal Emotion Recognition in Conversation","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2607.17366","snapshot_observed_at":"2026-08-01T18:16:47.824858Z","title":null,"venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2607.17366","last_updated":"2026-07-19T18:09:54Z","snapshot_observed_at":"2026-08-09T09:33:01.501071Z","submitted_at":"2026-07-19T18:09:54Z","title":"EII-SCL: Harnessing Emotional Inertia for Multimodal Emotion Recognition in Conversation","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-01T18:16:47.824858Z"},"links":{"cited_paper":"/paper/2607.17366","citing_paper":"/paper/2607.17366"},"observation_digest":"sha256:397d7c7fb537bb8267f74f623f1338049eccd55eb6ee6bae1a0fa550e45f81d7","observation_id":"645a0f54-ba18-4311-83bb-a9a697feb0d2","resolution":{"observed_at":"2026-08-01T18:16:47.824858Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"links":{"evidence":"/evidence","html":"/paper/2607.17366/citation-record","integrity":"/paper/2607.17366/integrity","json":"/paper/2607.17366/citation-record.json","paper":"/paper/2607.17366"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T18:16:47.758529Z","title":"Different from traditional emotion recog- nition, ERC analyzes dialogue turns and assigns one emotion label per utterance in the dialogue [2, 3]","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.17366","last_updated":"2026-07-19T18:09:54Z","snapshot_observed_at":"2026-08-09T09:33:01.501071Z","submitted_at":"2026-07-19T18:09:54Z","title":"EII-SCL: Harnessing Emotional Inertia for Multimodal Emotion Recognition in Conversation","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-01T18:16:47.758529Z"},"links":{"citing_paper":"/paper/2607.17366"},"observation_digest":"sha256:e1f6d5e7809bca9333a814a38b53d07215e69132cf8724466e27b301e7f24a8b","observation_id":"72abece3-c238-4658-85bc-48e663214d53","resolution":{"observed_at":"2026-08-01T18:16:47.758529Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2607.17366","last_updated":"2026-07-19T18:09:54Z","snapshot_observed_at":"2026-08-09T09:33:01.501071Z","submitted_at":"2026-07-19T18:09:54Z","title":"EII-SCL: Harnessing Emotional Inertia for Multimodal Emotion Recognition in Conversation","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2607.17366","snapshot_observed_at":"2026-08-01T18:16:47.824858Z","title":null,"venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2607.17366","last_updated":"2026-07-19T18:09:54Z","snapshot_observed_at":"2026-08-09T09:33:01.501071Z","submitted_at":"2026-07-19T18:09:54Z","title":"EII-SCL: Harnessing Emotional Inertia for Multimodal Emotion Recognition in Conversation","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-01T18:16:47.824858Z"},"links":{"cited_paper":"/paper/2607.17366","citing_paper":"/paper/2607.17366"},"observation_digest":"sha256:397d7c7fb537bb8267f74f623f1338049eccd55eb6ee6bae1a0fa550e45f81d7","observation_id":"645a0f54-ba18-4311-83bb-a9a697feb0d2","resolution":{"observed_at":"2026-08-01T18:16:47.824858Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T18:16:47.952187Z","title":"frustrated","venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2607.17366","last_updated":"2026-07-19T18:09:54Z","snapshot_observed_at":"2026-08-09T09:33:01.501071Z","submitted_at":"2026-07-19T18:09:54Z","title":"EII-SCL: Harnessing Emotional Inertia for Multimodal Emotion Recognition in Conversation","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-01T18:16:47.952187Z"},"links":{"citing_paper":"/paper/2607.17366"},"observation_digest":"sha256:934e15fa1db84bea9878f22ab72e8b06c65d2522f80bd84f91e53f5531b214ba","observation_id":"83f6c1b0-c479-443c-888a-63ae682d2e83","resolution":{"observed_at":"2026-08-01T18:16:47.952187Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T18:16:48.037266Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.17366","last_updated":"2026-07-19T18:09:54Z","snapshot_observed_at":"2026-08-09T09:33:01.501071Z","submitted_at":"2026-07-19T18:09:54Z","title":"EII-SCL: Harnessing Emotional Inertia for Multimodal Emotion Recognition in Conversation","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-01T18:16:48.037266Z"},"links":{"citing_paper":"/paper/2607.17366"},"observation_digest":"sha256:8418cb8f39f950dd72dd905b75d725cd6fd88e9eaa9b1c5a19eab32da97b44fe","observation_id":"d5c4c135-59be-438a-bfdf-47d6c4fef071","resolution":{"observed_at":"2026-08-01T18:16:48.037266Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T18:16:48.121813Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.17366","last_updated":"2026-07-19T18:09:54Z","snapshot_observed_at":"2026-08-09T09:33:01.501071Z","submitted_at":"2026-07-19T18:09:54Z","title":"EII-SCL: Harnessing Emotional Inertia for Multimodal Emotion Recognition in Conversation","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-01T18:16:48.121813Z"},"links":{"citing_paper":"/paper/2607.17366"},"observation_digest":"sha256:ef89412ee31024d978e0eabdc45d65730cb948300e025b286284daff28a99de6","observation_id":"7f56b82f-b977-4a36-bbf6-d3df41f54d02","resolution":{"observed_at":"2026-08-01T18:16:48.121813Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T18:16:48.195342Z","title":"All scientific content, experiments and analyses were produced and verified by the authors","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.17366","last_updated":"2026-07-19T18:09:54Z","snapshot_observed_at":"2026-08-09T09:33:01.501071Z","submitted_at":"2026-07-19T18:09:54Z","title":"EII-SCL: Harnessing Emotional Inertia for Multimodal Emotion Recognition in Conversation","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-01T18:16:48.195342Z"},"links":{"citing_paper":"/paper/2607.17366"},"observation_digest":"sha256:db36fdb4763eacab2e52c966a8ef8aba578f93ee7ae6ffed271ae4d31ec1f9ff","observation_id":"a2c4a905-2744-4b50-a8f2-c139c85bff74","resolution":{"observed_at":"2026-08-01T18:16:48.195342Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2604.25624","last_updated":"2026-04-28T13:30:17Z","snapshot_observed_at":"2026-08-07T04:40:15.889438Z","submitted_at":"2026-04-28T13:30:17Z","title":"UNet-Based Fusion and Exponential Moving Average Adaptation for Noise-Robust Speaker Recognition","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2604.25624","snapshot_observed_at":"2026-08-01T18:16:48.844266Z","title":"UNet-based fusion and exponential moving average adaptation for noise-robust speaker recognition,","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2607.17366","last_updated":"2026-07-19T18:09:54Z","snapshot_observed_at":"2026-08-09T09:33:01.501071Z","submitted_at":"2026-07-19T18:09:54Z","title":"EII-SCL: Harnessing Emotional Inertia for Multimodal Emotion Recognition in Conversation","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-01T18:16:48.844266Z"},"links":{"cited_paper":"/paper/2604.25624","citing_paper":"/paper/2607.17366"},"observation_digest":"sha256:03289d224d764da5238e73f8824c3e56290338c38ab2a1e7b8647fff4aab9dae","observation_id":"009ef8f6-bad0-4fba-83e3-c6f87b363d52","resolution":{"observed_at":"2026-08-01T18:16:48.844266Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T18:16:48.270725Z","title":"Current state of text sentiment analysis from opinion to emotion mining,","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2607.17366","last_updated":"2026-07-19T18:09:54Z","snapshot_observed_at":"2026-08-09T09:33:01.501071Z","submitted_at":"2026-07-19T18:09:54Z","title":"EII-SCL: Harnessing Emotional Inertia for Multimodal Emotion Recognition in Conversation","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-01T18:16:48.270725Z"},"links":{"citing_paper":"/paper/2607.17366"},"observation_digest":"sha256:9515ddb113409c4a82ff5bffb9c1659429918c8bbca42ba52a78b93381556f3a","observation_id":"1952ea8d-fd61-4cec-b8f4-48e39677ec5e","resolution":{"observed_at":"2026-08-01T18:16:48.270725Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T18:16:48.354608Z","title":"Emotion recognition in conversation: Research challenges, datasets, and recent advances,","venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2607.17366","last_updated":"2026-07-19T18:09:54Z","snapshot_observed_at":"2026-08-09T09:33:01.501071Z","submitted_at":"2026-07-19T18:09:54Z","title":"EII-SCL: Harnessing Emotional Inertia for Multimodal Emotion Recognition in Conversation","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-01T18:16:48.354608Z"},"links":{"citing_paper":"/paper/2607.17366"},"observation_digest":"sha256:0f08ba400c2a123b2db588e938c05b2a1e641d980335aec510875990b31383c0","observation_id":"13515eed-cfca-4ab8-a1fb-39767cb1c7d9","resolution":{"observed_at":"2026-08-01T18:16:48.354608Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T18:16:48.463551Z","title":"MM-NodeFormer: Node transformer multimodal fusion for emotion recognition in conver- sation,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.17366","last_updated":"2026-07-19T18:09:54Z","snapshot_observed_at":"2026-08-09T09:33:01.501071Z","submitted_at":"2026-07-19T18:09:54Z","title":"EII-SCL: Harnessing Emotional Inertia for Multimodal Emotion Recognition in Conversation","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-01T18:16:48.463551Z"},"links":{"citing_paper":"/paper/2607.17366"},"observation_digest":"sha256:68523b29251c5984052f8718e220eb67991099190dbf1fd240c40a02a99769a8","observation_id":"a3fa004d-5bce-4014-8b79-5143e8ce8222","resolution":{"observed_at":"2026-08-01T18:16:48.463551Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2107.06779","last_updated":"2021-07-14T15:37:02Z","snapshot_observed_at":"2026-07-06T11:29:07.489964Z","submitted_at":"2021-07-14T15:37:02Z","title":"MMGCN: Multimodal Fusion via Deep Graph Convolution Network for Emotion Recognition in Conversation","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2107.06779","snapshot_observed_at":"2026-08-01T18:16:48.540579Z","title":"MMGCN: Multimodal fusion via deep graph convolution network for emotion recognition in conversation,","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2607.17366","last_updated":"2026-07-19T18:09:54Z","snapshot_observed_at":"2026-08-09T09:33:01.501071Z","submitted_at":"2026-07-19T18:09:54Z","title":"EII-SCL: Harnessing Emotional Inertia for Multimodal Emotion Recognition in Conversation","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-01T18:16:48.540579Z"},"links":{"cited_paper":"/paper/2107.06779","citing_paper":"/paper/2607.17366"},"observation_digest":"sha256:b7a891d0c36474a1265a61f9de53195a3d625adebdd6b3e803882fdf077bf579","observation_id":"0b1d7b1a-0a36-4ca0-80bd-e35dfd0958a1","resolution":{"observed_at":"2026-08-01T18:16:48.540579Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T18:16:48.636778Z","title":"Adaptive graph learning for multimodal conversational emotion detection,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.17366","last_updated":"2026-07-19T18:09:54Z","snapshot_observed_at":"2026-08-09T09:33:01.501071Z","submitted_at":"2026-07-19T18:09:54Z","title":"EII-SCL: Harnessing Emotional Inertia for Multimodal Emotion Recognition in Conversation","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-01T18:16:48.636778Z"},"links":{"citing_paper":"/paper/2607.17366"},"observation_digest":"sha256:6020cda164316a5d6b8cdf6f7bbffb3ab57f2e54696b18eb7bb8ec0e2f3bfa0a","observation_id":"cb07972a-8a14-4b09-8ab2-e42e22aa7e12","resolution":{"observed_at":"2026-08-01T18:16:48.636778Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T18:16:48.718443Z","title":"Distilling attention knowledge for speaker verification,","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2607.17366","last_updated":"2026-07-19T18:09:54Z","snapshot_observed_at":"2026-08-09T09:33:01.501071Z","submitted_at":"2026-07-19T18:09:54Z","title":"EII-SCL: Harnessing Emotional Inertia for Multimodal Emotion Recognition in Conversation","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-01T18:16:48.718443Z"},"links":{"citing_paper":"/paper/2607.17366"},"observation_digest":"sha256:be6158a880e2f4263c4ecab7cd26c8894f532e82cad87b0e7ceaf6bce4e83e23","observation_id":"e92b0f7a-3eb1-40b2-810a-c6ba5ba99a08","resolution":{"observed_at":"2026-08-01T18:16:48.718443Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T18:16:49.664826Z","title":"A transformer-based model with self-distillation for multimodal emotion recognition in conversations,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2607.17366","last_updated":"2026-07-19T18:09:54Z","snapshot_observed_at":"2026-08-09T09:33:01.501071Z","submitted_at":"2026-07-19T18:09:54Z","title":"EII-SCL: Harnessing Emotional Inertia for Multimodal Emotion Recognition in Conversation","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-01T18:16:49.664826Z"},"links":{"citing_paper":"/paper/2607.17366"},"observation_digest":"sha256:3224f05a2409cab38ee65fd8ea6717a04e5281a3a19a3b95059c0c66a6363017","observation_id":"2cc8a6a9-2011-4661-8997-3ff371acf5e5","resolution":{"observed_at":"2026-08-01T18:16:49.664826Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T18:16:48.946415Z","title":"Curriculum learning meets directed acyclic graph for multimodal emotion recogni- tion,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.17366","last_updated":"2026-07-19T18:09:54Z","snapshot_observed_at":"2026-08-09T09:33:01.501071Z","submitted_at":"2026-07-19T18:09:54Z","title":"EII-SCL: Harnessing Emotional Inertia for Multimodal Emotion Recognition in Conversation","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-01T18:16:48.946415Z"},"links":{"citing_paper":"/paper/2607.17366"},"observation_digest":"sha256:ae7c9f645b62b6b8bfb542fd9ffc55ef8bf311be85e57d0ad68b63959f86557e","observation_id":"c01ace01-0473-4aa1-af77-233661c0da0b","resolution":{"observed_at":"2026-08-01T18:16:48.946415Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T18:16:49.021798Z","title":"De- noising student features with diffusion models for knowledge dis- tillation in speaker verification,","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.17366","last_updated":"2026-07-19T18:09:54Z","snapshot_observed_at":"2026-08-09T09:33:01.501071Z","submitted_at":"2026-07-19T18:09:54Z","title":"EII-SCL: Harnessing Emotional Inertia for Multimodal Emotion Recognition in Conversation","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-01T18:16:49.021798Z"},"links":{"citing_paper":"/paper/2607.17366"},"observation_digest":"sha256:7abd12f6a46974ba8977b02d94558a36ff2a57b552df1dd8f3ed3f79f33f057f","observation_id":"f5886282-7ab0-4551-b7a8-63a8c175a898","resolution":{"observed_at":"2026-08-01T18:16:49.021798Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T18:16:49.143508Z","title":"BA V-MossFormer2: En- hanced MossFormer2 for binaural audio-visual speech enhance- ment,","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.17366","last_updated":"2026-07-19T18:09:54Z","snapshot_observed_at":"2026-08-09T09:33:01.501071Z","submitted_at":"2026-07-19T18:09:54Z","title":"EII-SCL: Harnessing Emotional Inertia for Multimodal Emotion Recognition in Conversation","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-01T18:16:49.143508Z"},"links":{"citing_paper":"/paper/2607.17366"},"observation_digest":"sha256:6083585a3357fdbfec1578615a4cad935083d49912251be0506cd67a377e01c8","observation_id":"184e7a6f-9bc5-47b1-a5fc-d282b2bfb03e","resolution":{"observed_at":"2026-08-01T18:16:49.143508Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T18:16:49.222562Z","title":"COLD Fusion: Calibrated and or- dinal latent distribution fusion for uncertainty-aware multimodal emotion recognition,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.17366","last_updated":"2026-07-19T18:09:54Z","snapshot_observed_at":"2026-08-09T09:33:01.501071Z","submitted_at":"2026-07-19T18:09:54Z","title":"EII-SCL: Harnessing Emotional Inertia for Multimodal Emotion Recognition in Conversation","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-01T18:16:49.222562Z"},"links":{"citing_paper":"/paper/2607.17366"},"observation_digest":"sha256:93db574bfef0a6cc64666221da31612c2e34842faf6a8e0c76971a56c9210f4e","observation_id":"bb91f7e8-0f42-42f1-a889-93840c1129d6","resolution":{"observed_at":"2026-08-01T18:16:49.222562Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T18:16:49.376741Z","title":"Feature-enhanced multi- modal interaction model for emotion recognition in conversation,","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.17366","last_updated":"2026-07-19T18:09:54Z","snapshot_observed_at":"2026-08-09T09:33:01.501071Z","submitted_at":"2026-07-19T18:09:54Z","title":"EII-SCL: Harnessing Emotional Inertia for Multimodal Emotion Recognition in Conversation","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-01T18:16:49.376741Z"},"links":{"citing_paper":"/paper/2607.17366"},"observation_digest":"sha256:1ccd85a379766cd2084e879cfe3965e859cfb57f6143cfe2aef28ad191847bdc","observation_id":"4de94e72-4934-4909-968c-8a643d5f77d7","resolution":{"observed_at":"2026-08-01T18:16:49.376741Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T18:16:49.510511Z","title":"IDIR: Identifying and Distilling Informative Relations for Speaker Verification,","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.17366","last_updated":"2026-07-19T18:09:54Z","snapshot_observed_at":"2026-08-09T09:33:01.501071Z","submitted_at":"2026-07-19T18:09:54Z","title":"EII-SCL: Harnessing Emotional Inertia for Multimodal Emotion Recognition in Conversation","version":1},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-01T18:16:49.510511Z"},"links":{"citing_paper":"/paper/2607.17366"},"observation_digest":"sha256:4412c30577cee793e61a11e75d68e54d6544d803222cdf9aeb5758be99dfb30a","observation_id":"73919535-3b20-4181-b302-85a8ee2b9a73","resolution":{"observed_at":"2026-08-01T18:16:49.510511Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T18:16:47.874082Z","title":",fk] = FeatureFusion[R(t),R (a),R (v)],(4) wheref i ∈R Df denotes the fused multimodal embedding of utteranceu i","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.17366","last_updated":"2026-07-19T18:09:54Z","snapshot_observed_at":"2026-08-09T09:33:01.501071Z","submitted_at":"2026-07-19T18:09:54Z","title":"EII-SCL: Harnessing Emotional Inertia for Multimodal Emotion Recognition in Conversation","version":1},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-01T18:16:47.874082Z"},"links":{"citing_paper":"/paper/2607.17366"},"observation_digest":"sha256:a781e8f002df94ce904d888aace87c3066b118eff9895434cebcb906a9846209","observation_id":"f5c08cd9-b8e8-4a88-801a-e69325fb0869","resolution":{"observed_at":"2026-08-01T18:16:47.874082Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T18:16:49.766434Z","title":"Emotional inertia and psychological maladjustment,","venue":null,"work_id":null,"year":2010},"citing_paper":{"arxiv_id":"2607.17366","last_updated":"2026-07-19T18:09:54Z","snapshot_observed_at":"2026-08-09T09:33:01.501071Z","submitted_at":"2026-07-19T18:09:54Z","title":"EII-SCL: Harnessing Emotional Inertia for Multimodal Emotion Recognition in Conversation","version":1},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-01T18:16:49.766434Z"},"links":{"citing_paper":"/paper/2607.17366"},"observation_digest":"sha256:ca88d317646b1437a09ce6d93df50d26dff62a2e5a761f780d5a9223ea342f5d","observation_id":"5d995a1f-7ddb-4018-b021-fdc78c76f36a","resolution":{"observed_at":"2026-08-01T18:16:49.766434Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T18:16:49.879939Z","title":"Emotional inertia and external events: The roles of exposure, reactivity, and recovery,","venue":null,"work_id":null,"year":2015},"citing_paper":{"arxiv_id":"2607.17366","last_updated":"2026-07-19T18:09:54Z","snapshot_observed_at":"2026-08-09T09:33:01.501071Z","submitted_at":"2026-07-19T18:09:54Z","title":"EII-SCL: Harnessing Emotional Inertia for Multimodal Emotion Recognition in Conversation","version":1},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-01T18:16:49.879939Z"},"links":{"citing_paper":"/paper/2607.17366"},"observation_digest":"sha256:2e39da17a82c56d9f9ddd0b411b4cdc7ca942c3c72a315830c02d0dd62f4c0b3","observation_id":"85bdb635-8b1d-480d-a8b1-d795aadd987e","resolution":{"observed_at":"2026-08-01T18:16:49.879939Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T18:16:50.009513Z","title":"Emotion recognition in conversations with emotion shift detection based on multi-task learning,","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2607.17366","last_updated":"2026-07-19T18:09:54Z","snapshot_observed_at":"2026-08-09T09:33:01.501071Z","submitted_at":"2026-07-19T18:09:54Z","title":"EII-SCL: Harnessing Emotional Inertia for Multimodal Emotion Recognition in Conversation","version":1},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-01T18:16:50.009513Z"},"links":{"citing_paper":"/paper/2607.17366"},"observation_digest":"sha256:948173dfc4b08bd621a35f8bf7e78dd18d6657b416a0aa8aa952f57df17e9b76","observation_id":"a5666021-908d-46c5-9cc5-f7701cbc71c3","resolution":{"observed_at":"2026-08-01T18:16:50.009513Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T18:16:50.132145Z","title":"Hybrid curriculum learn- ing for emotion recognition in conversation,","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2607.17366","last_updated":"2026-07-19T18:09:54Z","snapshot_observed_at":"2026-08-09T09:33:01.501071Z","submitted_at":"2026-07-19T18:09:54Z","title":"EII-SCL: Harnessing Emotional Inertia for Multimodal Emotion Recognition in Conversation","version":1},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-08-01T18:16:50.132145Z"},"links":{"citing_paper":"/paper/2607.17366"},"observation_digest":"sha256:1dd14d4ba8d1911c7cfb2d486b66d4018754cef738558d068366e8a44261de47","observation_id":"ab6a7b5e-b10e-4a61-b269-422ded8b7657","resolution":{"observed_at":"2026-08-01T18:16:50.132145Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T18:16:50.204190Z","title":"The Emotion is Not One-hot Encoding: Learning with Grayscale Label for Emotion Recognition in Conversation,","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2607.17366","last_updated":"2026-07-19T18:09:54Z","snapshot_observed_at":"2026-08-09T09:33:01.501071Z","submitted_at":"2026-07-19T18:09:54Z","title":"EII-SCL: Harnessing Emotional Inertia for Multimodal Emotion Recognition in Conversation","version":1},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-08-01T18:16:50.204190Z"},"links":{"citing_paper":"/paper/2607.17366"},"observation_digest":"sha256:341cb400b72de928dae165bdbaa743fecf96aaf483c97ca262f818fc9887affe","observation_id":"1c032a20-ee69-4d70-b653-7d7bb73f61ae","resolution":{"observed_at":"2026-08-01T18:16:50.204190Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T18:16:50.337252Z","title":"Beyond single emotion: Multi-label ap- proach to conversational emotion recognition,","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.17366","last_updated":"2026-07-19T18:09:54Z","snapshot_observed_at":"2026-08-09T09:33:01.501071Z","submitted_at":"2026-07-19T18:09:54Z","title":"EII-SCL: Harnessing Emotional Inertia for Multimodal Emotion Recognition in Conversation","version":1},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-08-01T18:16:50.337252Z"},"links":{"citing_paper":"/paper/2607.17366"},"observation_digest":"sha256:54799cb1572720eae8640088b2e113d304be7383c8521fdbd116009dcc78f297","observation_id":"fbc0fa7e-ffa2-4acf-a14e-3832a8c4ddc2","resolution":{"observed_at":"2026-08-01T18:16:50.337252Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T18:16:50.447076Z","title":"M2FNET: Multi-modal fusion network for emotion recognition in conversation,","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2607.17366","last_updated":"2026-07-19T18:09:54Z","snapshot_observed_at":"2026-08-09T09:33:01.501071Z","submitted_at":"2026-07-19T18:09:54Z","title":"EII-SCL: Harnessing Emotional Inertia for Multimodal Emotion Recognition in Conversation","version":1},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-08-01T18:16:50.447076Z"},"links":{"citing_paper":"/paper/2607.17366"},"observation_digest":"sha256:dd7138f2b416315a0e22791c651b5ec22bd7cceae31ca164393da7a95a54dcda","observation_id":"21d77d50-9852-4da9-a62f-6eda1a211042","resolution":{"observed_at":"2026-08-01T18:16:50.447076Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1908.11540","last_updated":"2019-08-30T05:44:24Z","snapshot_observed_at":"2026-08-08T21:30:25.594108Z","submitted_at":"2019-08-30T05:44:24Z","title":"DialogueGCN: A Graph Convolutional Neural Network for Emotion Recognition in Conversation","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1908.11540","snapshot_observed_at":"2026-08-01T18:16:50.602525Z","title":"DialogueGCN: A graph convolutional neural net- work for emotion recognition in conversation,","venue":null,"work_id":null,"year":1908},"citing_paper":{"arxiv_id":"2607.17366","last_updated":"2026-07-19T18:09:54Z","snapshot_observed_at":"2026-08-09T09:33:01.501071Z","submitted_at":"2026-07-19T18:09:54Z","title":"EII-SCL: Harnessing Emotional Inertia for Multimodal Emotion Recognition in Conversation","version":1},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-08-01T18:16:50.602525Z"},"links":{"cited_paper":"/paper/1908.11540","citing_paper":"/paper/2607.17366"},"observation_digest":"sha256:53ce9a17fc685dfab2c0ea55ecd0a1f9bcdd8e9b1d071c6e56fd8ddaf153463a","observation_id":"380ded5e-fbbe-4158-ae3d-3daffa656ca6","resolution":{"observed_at":"2026-08-01T18:16:50.602525Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2307.15432","last_updated":"2024-04-13T01:05:05Z","snapshot_observed_at":"2026-08-07T09:16:33.171687Z","submitted_at":"2023-07-28T09:29:42Z","title":"CFN-ESA: A Cross-Modal Fusion Network with Emotion-Shift Awareness for Dialogue Emotion Recognition","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2307.15432","snapshot_observed_at":"2026-08-01T18:16:50.710392Z","title":"CFN-ESA: A cross-modal fusion network with emotion-shift awareness for dialogue emo- tion recognition,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2607.17366","last_updated":"2026-07-19T18:09:54Z","snapshot_observed_at":"2026-08-09T09:33:01.501071Z","submitted_at":"2026-07-19T18:09:54Z","title":"EII-SCL: Harnessing Emotional Inertia for Multimodal Emotion Recognition in Conversation","version":1},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-08-01T18:16:50.710392Z"},"links":{"cited_paper":"/paper/2307.15432","citing_paper":"/paper/2607.17366"},"observation_digest":"sha256:b75459ca29526bfcce71ab420f0dce1ab9b94f221909d7b925b53d4e63c13cfe","observation_id":"582d0d96-59ab-4dae-8baf-17c1da83f246","resolution":{"observed_at":"2026-08-01T18:16:50.710392Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T18:16:50.896934Z","title":"DER-GCN: Dialog and event relation-aware graph convolutional neural network for mul- timodal dialog emotion recognition,","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.17366","last_updated":"2026-07-19T18:09:54Z","snapshot_observed_at":"2026-08-09T09:33:01.501071Z","submitted_at":"2026-07-19T18:09:54Z","title":"EII-SCL: Harnessing Emotional Inertia for Multimodal Emotion Recognition in Conversation","version":1},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-08-01T18:16:50.896934Z"},"links":{"citing_paper":"/paper/2607.17366"},"observation_digest":"sha256:523f475312c8a886b7941144b0627cc76b8ba0588239c7bcc185541d832d2d7f","observation_id":"37bd7782-6589-4790-9732-7dbef7cbb058","resolution":{"observed_at":"2026-08-01T18:16:50.896934Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T18:16:51.116094Z","title":"IEMOCAP: Interactive emotional dyadic motion capture database,","venue":null,"work_id":null,"year":2008},"citing_paper":{"arxiv_id":"2607.17366","last_updated":"2026-07-19T18:09:54Z","snapshot_observed_at":"2026-08-09T09:33:01.501071Z","submitted_at":"2026-07-19T18:09:54Z","title":"EII-SCL: Harnessing Emotional Inertia for Multimodal Emotion Recognition in Conversation","version":1},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-08-01T18:16:51.116094Z"},"links":{"citing_paper":"/paper/2607.17366"},"observation_digest":"sha256:5185e008e78905cbf90ae1fe9c5e8f83504f5ab995c0d8851ceff7c31f6d8e39","observation_id":"e18e443f-da23-45e9-b58f-049d00e23dcc","resolution":{"observed_at":"2026-08-01T18:16:51.116094Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1810.02508","last_updated":"2019-06-04T12:33:49Z","snapshot_observed_at":"2026-07-06T07:06:12.726165Z","submitted_at":"2018-10-05T03:50:24Z","title":"MELD: A Multimodal Multi-Party Dataset for Emotion Recognition in Conversations","version":6},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1810.02508","snapshot_observed_at":"2026-08-01T18:16:51.388447Z","title":"MELD: A multimodal multi-party dataset for emotion recognition in conversations,","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2607.17366","last_updated":"2026-07-19T18:09:54Z","snapshot_observed_at":"2026-08-09T09:33:01.501071Z","submitted_at":"2026-07-19T18:09:54Z","title":"EII-SCL: Harnessing Emotional Inertia for Multimodal Emotion Recognition in Conversation","version":1},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-08-01T18:16:51.388447Z"},"links":{"cited_paper":"/paper/1810.02508","citing_paper":"/paper/2607.17366"},"observation_digest":"sha256:f9a427a7104e08bcfb0b0881d7f2cd3295a5f5d3e59073ec041b026bc32b2555","observation_id":"acb99571-8d10-496e-a60d-d94f803d3602","resolution":{"observed_at":"2026-08-01T18:16:51.388447Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T18:16:51.573531Z","title":"MM-DFN: Mul- timodal dynamic fusion network for emotion recognition in con- versations,","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2607.17366","last_updated":"2026-07-19T18:09:54Z","snapshot_observed_at":"2026-08-09T09:33:01.501071Z","submitted_at":"2026-07-19T18:09:54Z","title":"EII-SCL: Harnessing Emotional Inertia for Multimodal Emotion Recognition in Conversation","version":1},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-08-01T18:16:51.573531Z"},"links":{"citing_paper":"/paper/2607.17366"},"observation_digest":"sha256:b403773473086c0ed4320daabee027e211740e943b41bceaa7c2118b6ee2b2b1","observation_id":"65ef8de5-cdb8-4f65-b8b3-12ebf86e9d54","resolution":{"observed_at":"2026-08-01T18:16:51.573531Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1907.11692","last_updated":"2019-07-26T17:48:29Z","snapshot_observed_at":"2026-07-31T22:31:37.910868Z","submitted_at":"2019-07-26T17:48:29Z","title":"RoBERTa: A Robustly Optimized BERT Pretraining Approach","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1907.11692","snapshot_observed_at":"2026-08-01T18:16:51.811004Z","title":"RoBERTa: A robustly optimized bert pretraining approach,","venue":null,"work_id":null,"year":1907},"citing_paper":{"arxiv_id":"2607.17366","last_updated":"2026-07-19T18:09:54Z","snapshot_observed_at":"2026-08-09T09:33:01.501071Z","submitted_at":"2026-07-19T18:09:54Z","title":"EII-SCL: Harnessing Emotional Inertia for Multimodal Emotion Recognition in Conversation","version":1},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-08-01T18:16:51.811004Z"},"links":{"cited_paper":"/paper/1907.11692","citing_paper":"/paper/2607.17366"},"observation_digest":"sha256:8de64df43320b244fa1443675293ece2af54d749906b1128fccbb5f6f29df5f0","observation_id":"562f7139-2ce8-42d6-82ac-5c8af71d4bb6","resolution":{"observed_at":"2026-08-01T18:16:51.811004Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T18:16:52.006106Z","title":"wav2vec 2.0: A framework for self-supervised learning of speech repre- sentations,","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2607.17366","last_updated":"2026-07-19T18:09:54Z","snapshot_observed_at":"2026-08-09T09:33:01.501071Z","submitted_at":"2026-07-19T18:09:54Z","title":"EII-SCL: Harnessing Emotional Inertia for Multimodal Emotion Recognition in Conversation","version":1},"reference_index":36,"source":"pdf_text","source_observed_at":"2026-08-01T18:16:52.006106Z"},"links":{"citing_paper":"/paper/2607.17366"},"observation_digest":"sha256:b179b9dfcefe3ec4b5cf1404f227bea8b14d0a48586ad1c337652bf91ae6f0d5","observation_id":"889ee96b-5f5f-4930-b71d-373a72fbb195","resolution":{"observed_at":"2026-08-01T18:16:52.006106Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T18:16:52.159711Z","title":"Learning transferable visual models from natural language supervision,","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2607.17366","last_updated":"2026-07-19T18:09:54Z","snapshot_observed_at":"2026-08-09T09:33:01.501071Z","submitted_at":"2026-07-19T18:09:54Z","title":"EII-SCL: Harnessing Emotional Inertia for Multimodal Emotion Recognition in Conversation","version":1},"reference_index":37,"source":"pdf_text","source_observed_at":"2026-08-01T18:16:52.159711Z"},"links":{"citing_paper":"/paper/2607.17366"},"observation_digest":"sha256:668a58fff9e45b80fd596b2f5bfb06ced99f5e7daeebf51d3d5bd3da5adee29e","observation_id":"93f7e0d0-c137-4a83-8959-266640fd94ac","resolution":{"observed_at":"2026-08-01T18:16:52.159711Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"paper":{"arxiv_id":"2607.17366","last_updated":"2026-07-19T18:09:54Z","latest_version":1,"primary_category":"cs.MM","snapshot_observed_at":"2026-08-09T09:33:01.501071Z","submitted_at":"2026-07-19T18:09:54Z","title":"EII-SCL: Harnessing Emotional Inertia for Multimodal Emotion Recognition in Conversation"},"reference_resolution":{"displayed":37,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":37,"verified_exact":0,"verified_fuzzy":0},"total_outbound_references":37},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"thesis":"As of 9 August 2026, this Paper Citation Record lists 37 of 37 outbound references and 1 inbound Pith citation observation for arXiv:2607.17366."}