{"as_of":"2026-08-10T09:55:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:53ac366c056fb0d79f61e04b05cc156b28ecdc3cde8f5612573c06a9b921c074","coverage":[{"denominator":53,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":53,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-06T12:53:11.190273Z","state":"measured"},{"denominator":53,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":53,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-10T06:31:04.303077+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2507.21395/citation-record","integrity":"/paper/2507.21395/integrity","json":"/paper/2507.21395/citation-record.json","paper":"/paper/2507.21395"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T12:53:12.303805Z","title":"Exploring emotional connections: A systematic literature review of attachment in human-robot interaction,","venue":null,"work_id":"deb1d6a6-a3e9-4268-a904-b4d5ec46cc62","year":2025},"citing_paper":{"arxiv_id":"2507.21395","last_updated":"2025-07-29T00:03:28Z","snapshot_observed_at":"2026-08-06T12:53:09.509235Z","submitted_at":"2025-07-29T00:03:28Z","title":"Sync-TVA: A Graph-Attention Framework for Multimodal Emotion Recognition with Cross-Modal Fusion","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-06T12:53:10.901066Z"},"links":{"citing_paper":"/paper/2507.21395"},"observation_digest":"sha256:fdb488849951d8dbbc1c88830ef3d71be3bb3b6532eb8a0201d9e835fc450318","observation_id":"c8907b39-3d64-4146-89e8-af09aa2a51ee","resolution":{"observed_at":"2026-08-06T12:53:12.308932Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T12:53:12.286387Z","title":"Ai, robotics, medicine and health sciences,","venue":null,"work_id":"38501792-b5ae-4445-8484-a79c6531881a","year":2021},"citing_paper":{"arxiv_id":"2507.21395","last_updated":"2025-07-29T00:03:28Z","snapshot_observed_at":"2026-08-06T12:53:09.509235Z","submitted_at":"2025-07-29T00:03:28Z","title":"Sync-TVA: A Graph-Attention Framework for Multimodal Emotion Recognition with Cross-Modal Fusion","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-06T12:53:10.906361Z"},"links":{"citing_paper":"/paper/2507.21395"},"observation_digest":"sha256:7d7d4c2a40233fcf25f1169b79dc2f91469caf68a3814937ad6afaee240507fa","observation_id":"5e48f0f1-6c6d-41e2-90f2-b98f62f5b8f0","resolution":{"observed_at":"2026-08-06T12:53:12.292061Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T12:53:12.267583Z","title":"A scoping review of the literature on prosodic elements related to emotional speech in human-robot interaction,","venue":null,"work_id":"a134855a-cffa-44f8-96aa-265e3f01eea4","year":2024},"citing_paper":{"arxiv_id":"2507.21395","last_updated":"2025-07-29T00:03:28Z","snapshot_observed_at":"2026-08-06T12:53:09.509235Z","submitted_at":"2025-07-29T00:03:28Z","title":"Sync-TVA: A Graph-Attention Framework for Multimodal Emotion Recognition with Cross-Modal Fusion","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-06T12:53:10.911595Z"},"links":{"citing_paper":"/paper/2507.21395"},"observation_digest":"sha256:c4321564e529ce0986c3ce3dcc7f09404e2694b41f1fce36efcd1f48557cfe14","observation_id":"a840a6de-b39a-4a9a-a800-3483b22c357c","resolution":{"observed_at":"2026-08-06T12:53:12.273745Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T12:53:12.248711Z","title":"A novel emotion recognition system for human– robot interaction (hri) using deep ensemble classification,","venue":null,"work_id":"567ea0f7-c460-4932-841c-c98f25e299db","year":2025},"citing_paper":{"arxiv_id":"2507.21395","last_updated":"2025-07-29T00:03:28Z","snapshot_observed_at":"2026-08-06T12:53:09.509235Z","submitted_at":"2025-07-29T00:03:28Z","title":"Sync-TVA: A Graph-Attention Framework for Multimodal Emotion Recognition with Cross-Modal Fusion","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-06T12:53:10.916925Z"},"links":{"citing_paper":"/paper/2507.21395"},"observation_digest":"sha256:c6bc98e65a9a02f620cc282fdc2dbe8f24fed32a3bdd2f2f3eabf56e445ca5b2","observation_id":"30e87067-317c-428c-92db-ddb8b56c14ec","resolution":{"observed_at":"2026-08-06T12:53:12.253509Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T12:53:12.230330Z","title":"Towards the development of affective facial expression recognition for human-robot interaction,","venue":null,"work_id":"e8f80ebe-74e2-4179-ad71-fd1750788e51","year":2017},"citing_paper":{"arxiv_id":"2507.21395","last_updated":"2025-07-29T00:03:28Z","snapshot_observed_at":"2026-08-06T12:53:09.509235Z","submitted_at":"2025-07-29T00:03:28Z","title":"Sync-TVA: A Graph-Attention Framework for Multimodal Emotion Recognition with Cross-Modal Fusion","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-06T12:53:10.921596Z"},"links":{"citing_paper":"/paper/2507.21395"},"observation_digest":"sha256:90b360ff57d9711c823ab3d0353f018939457a25f047b5e57b07cca8a34b15e1","observation_id":"13172f86-aba6-4a77-8b93-694597901a88","resolution":{"observed_at":"2026-08-06T12:53:12.236267Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T12:53:12.213492Z","title":"Multimodal human–robot interaction for human-centric smart manufacturing: a survey,","venue":null,"work_id":"429ca388-5a81-44e5-aa41-ba8c6ca68d62","year":2024},"citing_paper":{"arxiv_id":"2507.21395","last_updated":"2025-07-29T00:03:28Z","snapshot_observed_at":"2026-08-06T12:53:09.509235Z","submitted_at":"2025-07-29T00:03:28Z","title":"Sync-TVA: A Graph-Attention Framework for Multimodal Emotion Recognition with Cross-Modal Fusion","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-06T12:53:10.926328Z"},"links":{"citing_paper":"/paper/2507.21395"},"observation_digest":"sha256:e3907a8def5ac767657d5e061d811b75792e26fbc1375b2b7cc21b148138b41e","observation_id":"5772f65b-8e7d-40ab-b984-b735232feb9c","resolution":{"observed_at":"2026-08-06T12:53:12.218397Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T12:53:12.198424Z","title":"Beyond sentiment analysis: A review of recent trends in text based sentiment analysis and emotion detection,","venue":null,"work_id":"f472552e-0e8e-4a5f-b2b5-09b4606c341a","year":2023},"citing_paper":{"arxiv_id":"2507.21395","last_updated":"2025-07-29T00:03:28Z","snapshot_observed_at":"2026-08-06T12:53:09.509235Z","submitted_at":"2025-07-29T00:03:28Z","title":"Sync-TVA: A Graph-Attention Framework for Multimodal Emotion Recognition with Cross-Modal Fusion","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-06T12:53:10.931969Z"},"links":{"citing_paper":"/paper/2507.21395"},"observation_digest":"sha256:b68215d45fa5ec659dfbf69b78b895eb03a14cb65eae673b484359794e0e7966","observation_id":"b4f02fb9-2a47-490d-aea8-af533a34a17d","resolution":{"observed_at":"2026-08-06T12:53:12.203129Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T12:53:12.183791Z","title":"Deep learning–based text classification: a comprehensive review,","venue":null,"work_id":"a077c29f-ab66-4ad5-a20f-b431b6a5c0c6","year":2021},"citing_paper":{"arxiv_id":"2507.21395","last_updated":"2025-07-29T00:03:28Z","snapshot_observed_at":"2026-08-06T12:53:09.509235Z","submitted_at":"2025-07-29T00:03:28Z","title":"Sync-TVA: A Graph-Attention Framework for Multimodal Emotion Recognition with Cross-Modal Fusion","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-06T12:53:10.936766Z"},"links":{"citing_paper":"/paper/2507.21395"},"observation_digest":"sha256:d1bfb08c499c5528076d1fb28361380279b8eadebeb032e93c40754af9cab21b","observation_id":"eb86e02a-07ea-44f0-895b-3eb62ed77744","resolution":{"observed_at":"2026-08-06T12:53:12.188315Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T12:53:12.168559Z","title":"Building emotional dictionary for sentiment analysis of online news,","venue":null,"work_id":"23c368a2-ee79-4f1c-a4d9-572dfbced64c","year":2014},"citing_paper":{"arxiv_id":"2507.21395","last_updated":"2025-07-29T00:03:28Z","snapshot_observed_at":"2026-08-06T12:53:09.509235Z","submitted_at":"2025-07-29T00:03:28Z","title":"Sync-TVA: A Graph-Attention Framework for Multimodal Emotion Recognition with Cross-Modal Fusion","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-06T12:53:10.941709Z"},"links":{"citing_paper":"/paper/2507.21395"},"observation_digest":"sha256:6b2ba4964398135cf2976cd34e78d19293bbec94672cd69cc4faeb01fbd8cc10","observation_id":"e49521c0-ac90-4486-baf5-5e7234174e67","resolution":{"observed_at":"2026-08-06T12:53:12.173276Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T12:53:12.151542Z","title":"Deep convolutional neural networks for sentiment analysis of short texts,","venue":null,"work_id":"d4c3c041-a61e-49ed-adab-4117d16c0b2a","year":2014},"citing_paper":{"arxiv_id":"2507.21395","last_updated":"2025-07-29T00:03:28Z","snapshot_observed_at":"2026-08-06T12:53:09.509235Z","submitted_at":"2025-07-29T00:03:28Z","title":"Sync-TVA: A Graph-Attention Framework for Multimodal Emotion Recognition with Cross-Modal Fusion","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-06T12:53:10.946624Z"},"links":{"citing_paper":"/paper/2507.21395"},"observation_digest":"sha256:268789d82af638b45cf5311664c9c33da1cacbf0ee46153bbd2a3accdeaf54b1","observation_id":"5e425230-78a3-4ef5-9624-5d8c2bc2749f","resolution":{"observed_at":"2026-08-06T12:53:12.156368Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1510.03820","last_updated":"2016-04-06T23:20:27Z","snapshot_observed_at":"2026-08-06T02:26:48.879223Z","submitted_at":"2015-10-13T19:00:57Z","title":"A Sensitivity Analysis of (and Practitioners' Guide to) Convolutional Neural Networks for Sentence Classification","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1510.03820","snapshot_observed_at":"2026-08-06T12:53:10.951051Z","title":"A sensitivity analysis of (and practitioners’ guide to) convolutional neural networks for sentence classification,","venue":null,"work_id":null,"year":2015},"citing_paper":{"arxiv_id":"2507.21395","last_updated":"2025-07-29T00:03:28Z","snapshot_observed_at":"2026-08-06T12:53:09.509235Z","submitted_at":"2025-07-29T00:03:28Z","title":"Sync-TVA: A Graph-Attention Framework for Multimodal Emotion Recognition with Cross-Modal Fusion","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-06T12:53:10.951051Z"},"links":{"cited_paper":"/paper/1510.03820","citing_paper":"/paper/2507.21395"},"observation_digest":"sha256:7af2edf82cbb2c2cd8c3549c376157ced027924a22176935d644aff11f911234","observation_id":"b572515e-e625-4097-b6bf-8639821f7fbc","resolution":{"observed_at":"2026-08-06T12:53:10.951051Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T12:53:12.135446Z","title":"Recurrent neural networks for emotion recognition in video,","venue":null,"work_id":"f2b3d1e0-de37-405f-bda7-bd0059aadcfd","year":2015},"citing_paper":{"arxiv_id":"2507.21395","last_updated":"2025-07-29T00:03:28Z","snapshot_observed_at":"2026-08-06T12:53:09.509235Z","submitted_at":"2025-07-29T00:03:28Z","title":"Sync-TVA: A Graph-Attention Framework for Multimodal Emotion Recognition with Cross-Modal Fusion","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-06T12:53:10.956925Z"},"links":{"citing_paper":"/paper/2507.21395"},"observation_digest":"sha256:47e0ab9f2433a5fc1eea943d48be64c42a4b86a16036eff6223606011428faad","observation_id":"f5226e0e-e3bc-4196-96d1-0016f390cba6","resolution":{"observed_at":"2026-08-06T12:53:12.141024Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T12:53:12.119600Z","title":"Fundamentals of recurrent neural network (rnn) and long short-term memory (lstm) network,","venue":null,"work_id":"c6c26343-6457-4eb3-8133-90ae8d92a9e7","year":2020},"citing_paper":{"arxiv_id":"2507.21395","last_updated":"2025-07-29T00:03:28Z","snapshot_observed_at":"2026-08-06T12:53:09.509235Z","submitted_at":"2025-07-29T00:03:28Z","title":"Sync-TVA: A Graph-Attention Framework for Multimodal Emotion Recognition with Cross-Modal Fusion","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-06T12:53:10.961416Z"},"links":{"citing_paper":"/paper/2507.21395"},"observation_digest":"sha256:3feacbd64eb57b3b5d07e85de5355e96e0b958352e9f51f7211bc814fcfce40a","observation_id":"044045db-ecde-4f93-abc1-4238d311cd73","resolution":{"observed_at":"2026-08-06T12:53:12.124244Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T12:53:12.105015Z","title":"Text sentiment analysis based on long short-term memory,","venue":null,"work_id":"3a293e19-cd75-4d20-9eb8-97088eb3a9ae","year":2016},"citing_paper":{"arxiv_id":"2507.21395","last_updated":"2025-07-29T00:03:28Z","snapshot_observed_at":"2026-08-06T12:53:09.509235Z","submitted_at":"2025-07-29T00:03:28Z","title":"Sync-TVA: A Graph-Attention Framework for Multimodal Emotion Recognition with Cross-Modal Fusion","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-06T12:53:10.965861Z"},"links":{"citing_paper":"/paper/2507.21395"},"observation_digest":"sha256:cafc39d3a61573c80a9224a304d4f88028270847f15051a3185dd40bad3f7781","observation_id":"2ab7bb32-d0d6-4225-9b3f-dbee271ad00a","resolution":{"observed_at":"2026-08-06T12:53:12.109507Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T12:53:12.090034Z","title":"Emotion recognition from facial expressions using hybrid feature descriptors,","venue":null,"work_id":"1e704f4d-68ef-4df4-ab86-aba6ec7a570f","year":2018},"citing_paper":{"arxiv_id":"2507.21395","last_updated":"2025-07-29T00:03:28Z","snapshot_observed_at":"2026-08-06T12:53:09.509235Z","submitted_at":"2025-07-29T00:03:28Z","title":"Sync-TVA: A Graph-Attention Framework for Multimodal Emotion Recognition with Cross-Modal Fusion","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-06T12:53:10.970592Z"},"links":{"citing_paper":"/paper/2507.21395"},"observation_digest":"sha256:ce1b895d3db4560d969ed2bbb235d812a4cd8a34ee609344dde25d69c7ce846d","observation_id":"3f2e417f-6f12-4861-9304-7c8905a9d0ab","resolution":{"observed_at":"2026-08-06T12:53:12.094855Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T12:53:12.074736Z","title":"Using multiple steerable filters and bayesian regularization for facial expression recognition,","venue":null,"work_id":"5b2b880b-8127-406d-ae6a-f1e2d62205de","year":2015},"citing_paper":{"arxiv_id":"2507.21395","last_updated":"2025-07-29T00:03:28Z","snapshot_observed_at":"2026-08-06T12:53:09.509235Z","submitted_at":"2025-07-29T00:03:28Z","title":"Sync-TVA: A Graph-Attention Framework for Multimodal Emotion Recognition with Cross-Modal Fusion","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-06T12:53:10.974896Z"},"links":{"citing_paper":"/paper/2507.21395"},"observation_digest":"sha256:583aecad5c357bfc8b8cc716ff47981132407cc73a14e1d5dfc94c56ec5dce48","observation_id":"0cd8de46-0e41-488f-9a1d-496746b20724","resolution":{"observed_at":"2026-08-06T12:53:12.079812Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T12:53:12.059981Z","title":"Automatic speech emotion recogni- tion using support vector machine,","venue":null,"work_id":"24ac2433-1495-4f7a-b2a1-537ef0b14e37","year":2011},"citing_paper":{"arxiv_id":"2507.21395","last_updated":"2025-07-29T00:03:28Z","snapshot_observed_at":"2026-08-06T12:53:09.509235Z","submitted_at":"2025-07-29T00:03:28Z","title":"Sync-TVA: A Graph-Attention Framework for Multimodal Emotion Recognition with Cross-Modal Fusion","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-06T12:53:10.979660Z"},"links":{"citing_paper":"/paper/2507.21395"},"observation_digest":"sha256:d46d66bf62fec05a19eb3b33001fe91d93786194f307657bb457f5b54324a337","observation_id":"dffe03a9-5a99-4032-a446-a4aefcad4e72","resolution":{"observed_at":"2026-08-06T12:53:12.064621Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T12:53:12.042882Z","title":"Adieu features? end-to-end speech emotion recognition using a deep convolutional recurrent network,","venue":null,"work_id":"d2486f7a-d6db-46df-b83c-ba89f94f3233","year":2016},"citing_paper":{"arxiv_id":"2507.21395","last_updated":"2025-07-29T00:03:28Z","snapshot_observed_at":"2026-08-06T12:53:09.509235Z","submitted_at":"2025-07-29T00:03:28Z","title":"Sync-TVA: A Graph-Attention Framework for Multimodal Emotion Recognition with Cross-Modal Fusion","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-06T12:53:10.984240Z"},"links":{"citing_paper":"/paper/2507.21395"},"observation_digest":"sha256:dc4f3c7afafa3db750f35f97bacb86dafb8386565a3f1539cd0158fd5cfff2ab","observation_id":"aadc8dde-adb4-4df0-a6d2-ebe7333a39c3","resolution":{"observed_at":"2026-08-06T12:53:12.048643Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T12:53:12.024081Z","title":"Micro-expression recognition based on 3d flow convolutional neural network,","venue":null,"work_id":"85009dac-05a0-43c1-8831-85901fa1cb8d","year":2019},"citing_paper":{"arxiv_id":"2507.21395","last_updated":"2025-07-29T00:03:28Z","snapshot_observed_at":"2026-08-06T12:53:09.509235Z","submitted_at":"2025-07-29T00:03:28Z","title":"Sync-TVA: A Graph-Attention Framework for Multimodal Emotion Recognition with Cross-Modal Fusion","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-06T12:53:10.988606Z"},"links":{"citing_paper":"/paper/2507.21395"},"observation_digest":"sha256:6daadfdeb63a7221b04432d3229f30ad8d7ff1c004b649a0f1f811400bc96a95","observation_id":"ccaf72a0-0aaa-4196-bf20-255fadbcc725","resolution":{"observed_at":"2026-08-06T12:53:12.029312Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T12:53:12.006354Z","title":"Applying segment-level attention on bi- modal transformer encoder for audio-visual emotion recognition,","venue":null,"work_id":"a4c9c108-03ac-415f-a890-d9dca1c216c0","year":2023},"citing_paper":{"arxiv_id":"2507.21395","last_updated":"2025-07-29T00:03:28Z","snapshot_observed_at":"2026-08-06T12:53:09.509235Z","submitted_at":"2025-07-29T00:03:28Z","title":"Sync-TVA: A Graph-Attention Framework for Multimodal Emotion Recognition with Cross-Modal Fusion","version":1},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-06T12:53:10.993637Z"},"links":{"citing_paper":"/paper/2507.21395"},"observation_digest":"sha256:d0775e5927f992c91287088b332b9bd679257fda79764733ff2ba8cb08d289f3","observation_id":"df32d6e6-4ea6-4109-a0c9-25a0c2397baf","resolution":{"observed_at":"2026-08-06T12:53:12.012333Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T12:53:11.989407Z","title":"Multimodal and temporal perception of audio-visual cues for emotion recognition,","venue":null,"work_id":"9c97de52-7b83-4e65-b128-e004056ecb25","year":2019},"citing_paper":{"arxiv_id":"2507.21395","last_updated":"2025-07-29T00:03:28Z","snapshot_observed_at":"2026-08-06T12:53:09.509235Z","submitted_at":"2025-07-29T00:03:28Z","title":"Sync-TVA: A Graph-Attention Framework for Multimodal Emotion Recognition with Cross-Modal Fusion","version":1},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-06T12:53:10.998395Z"},"links":{"citing_paper":"/paper/2507.21395"},"observation_digest":"sha256:894f1e59d908d08ba7d84991c4b323ce11021d76941c8aac25262b1ba45ab2c1","observation_id":"32e84e13-d5eb-4b76-8154-d1f198e63977","resolution":{"observed_at":"2026-08-06T12:53:11.995330Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T12:53:11.973996Z","title":"Multimodal emotion recognition using deep generalized canonical correlation analysis with an attention mechanism,","venue":null,"work_id":"12b5a33c-8eb9-4fef-990d-186239fedc18","year":2020},"citing_paper":{"arxiv_id":"2507.21395","last_updated":"2025-07-29T00:03:28Z","snapshot_observed_at":"2026-08-06T12:53:09.509235Z","submitted_at":"2025-07-29T00:03:28Z","title":"Sync-TVA: A Graph-Attention Framework for Multimodal Emotion Recognition with Cross-Modal Fusion","version":1},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-06T12:53:11.002793Z"},"links":{"citing_paper":"/paper/2507.21395"},"observation_digest":"sha256:d5d651c19885f358177e3ab995c60c7535c9c74bcadfe398b4857e4425e5870e","observation_id":"a318e279-2920-4720-b4ec-f79d1a17fe68","resolution":{"observed_at":"2026-08-06T12:53:11.978784Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T12:53:11.958316Z","title":"Outlier processing in multimodal emotion recognition,","venue":null,"work_id":"77fe7de5-2e84-4323-bece-237443974ba3","year":2020},"citing_paper":{"arxiv_id":"2507.21395","last_updated":"2025-07-29T00:03:28Z","snapshot_observed_at":"2026-08-06T12:53:09.509235Z","submitted_at":"2025-07-29T00:03:28Z","title":"Sync-TVA: A Graph-Attention Framework for Multimodal Emotion Recognition with Cross-Modal Fusion","version":1},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-06T12:53:11.007286Z"},"links":{"citing_paper":"/paper/2507.21395"},"observation_digest":"sha256:2f812fb54c45c4227af1286db8393fcab132c96356368d55311db347afcdae0f","observation_id":"db8d1567-aee3-4403-a658-6cd2edc3d663","resolution":{"observed_at":"2026-08-06T12:53:11.963667Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T12:53:11.942491Z","title":"Graph-based hierarchical semantic consistency network for remote sensing image-text retrieval,","venue":null,"work_id":"8da5e153-d12d-4dc8-99cd-484445e803f8","year":2025},"citing_paper":{"arxiv_id":"2507.21395","last_updated":"2025-07-29T00:03:28Z","snapshot_observed_at":"2026-08-06T12:53:09.509235Z","submitted_at":"2025-07-29T00:03:28Z","title":"Sync-TVA: A Graph-Attention Framework for Multimodal Emotion Recognition with Cross-Modal Fusion","version":1},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-06T12:53:11.013056Z"},"links":{"citing_paper":"/paper/2507.21395"},"observation_digest":"sha256:96aec2d33311b081782b9f6bb4222b060010fa092d852cc4d98d9337ccfb65a3","observation_id":"b697cbe2-cc6a-4015-b691-ad6671a99d19","resolution":{"observed_at":"2026-08-06T12:53:11.947904Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T12:53:11.925751Z","title":"Fine-grained alignment and interaction for video grounding with cross- modal semantic hierarchical graph,","venue":null,"work_id":"edecb2c2-0b05-460f-9d43-0eba4d2495dd","year":2025},"citing_paper":{"arxiv_id":"2507.21395","last_updated":"2025-07-29T00:03:28Z","snapshot_observed_at":"2026-08-06T12:53:09.509235Z","submitted_at":"2025-07-29T00:03:28Z","title":"Sync-TVA: A Graph-Attention Framework for Multimodal Emotion Recognition with Cross-Modal Fusion","version":1},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-08-06T12:53:11.017794Z"},"links":{"citing_paper":"/paper/2507.21395"},"observation_digest":"sha256:265dd4d300eb66ed9509bc09f7325844e2f48cb79b06817f620ae688a8d2811b","observation_id":"78315896-7a8b-4499-8d94-69a188c31dc9","resolution":{"observed_at":"2026-08-06T12:53:11.931739Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T12:53:11.908768Z","title":"Hybrid multi-attention network for audio–visual emotion recognition through multimodal feature fusion,","venue":null,"work_id":"47ca15c8-f9d9-4fe0-b49a-5167488aba41","year":2025},"citing_paper":{"arxiv_id":"2507.21395","last_updated":"2025-07-29T00:03:28Z","snapshot_observed_at":"2026-08-06T12:53:09.509235Z","submitted_at":"2025-07-29T00:03:28Z","title":"Sync-TVA: A Graph-Attention Framework for Multimodal Emotion Recognition with Cross-Modal Fusion","version":1},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-08-06T12:53:11.022422Z"},"links":{"citing_paper":"/paper/2507.21395"},"observation_digest":"sha256:77b8f95fed3151a9ba86175f8d0051e13d289e51b44ada68c1a657909439a47d","observation_id":"924eb5c1-c193-4b6c-a078-e8d6004e3d65","resolution":{"observed_at":"2026-08-06T12:53:11.913749Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T12:53:11.891973Z","title":"Aia-net: Adaptive interactive attention network for text–audio emotion recognition,","venue":null,"work_id":"322dd914-1ae2-4a15-8a4e-5dc960e040b0","year":2022},"citing_paper":{"arxiv_id":"2507.21395","last_updated":"2025-07-29T00:03:28Z","snapshot_observed_at":"2026-08-06T12:53:09.509235Z","submitted_at":"2025-07-29T00:03:28Z","title":"Sync-TVA: A Graph-Attention Framework for Multimodal Emotion Recognition with Cross-Modal Fusion","version":1},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-08-06T12:53:11.028268Z"},"links":{"citing_paper":"/paper/2507.21395"},"observation_digest":"sha256:fb3b7044877c58ab34d7c5d594bbe7e6166c95d2ae61b338ce0895112abe9c45","observation_id":"084c2dc1-9f4e-4cad-9b44-a9f6acf77aaf","resolution":{"observed_at":"2026-08-06T12:53:11.898082Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T12:53:11.875932Z","title":"Dynamic and static fusion mechanisms of infrared and visible images,","venue":null,"work_id":"9af510fc-d12f-4793-b330-85b69fc08fa8","year":2024},"citing_paper":{"arxiv_id":"2507.21395","last_updated":"2025-07-29T00:03:28Z","snapshot_observed_at":"2026-08-06T12:53:09.509235Z","submitted_at":"2025-07-29T00:03:28Z","title":"Sync-TVA: A Graph-Attention Framework for Multimodal Emotion Recognition with Cross-Modal Fusion","version":1},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-08-06T12:53:11.034610Z"},"links":{"citing_paper":"/paper/2507.21395"},"observation_digest":"sha256:e180f3a9427b7882778e02c46e8fb1840c2983baad50afeab3896eafc6a2e8b0","observation_id":"e7a28fdf-9d2f-4f4f-b4a7-8f129cd58f47","resolution":{"observed_at":"2026-08-06T12:53:11.881056Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1911.03821","last_updated":"2021-01-26T08:08:02Z","snapshot_observed_at":"2026-08-06T12:56:05.362170Z","submitted_at":"2019-11-10T01:39:46Z","title":"Adaptive Fusion Techniques for Multimodal Data","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1911.03821","snapshot_observed_at":"2026-08-06T12:53:11.039296Z","title":"Adaptive fusion techniques for multi- modal data,","venue":null,"work_id":null,"year":1911},"citing_paper":{"arxiv_id":"2507.21395","last_updated":"2025-07-29T00:03:28Z","snapshot_observed_at":"2026-08-06T12:53:09.509235Z","submitted_at":"2025-07-29T00:03:28Z","title":"Sync-TVA: A Graph-Attention Framework for Multimodal Emotion Recognition with Cross-Modal Fusion","version":1},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-08-06T12:53:11.039296Z"},"links":{"cited_paper":"/paper/1911.03821","citing_paper":"/paper/2507.21395"},"observation_digest":"sha256:379ec7d1454d478774288da9463239d218596bb8d092b5ccc95404505ca0325e","observation_id":"62768984-9e57-4e85-b579-bf1e05b56eff","resolution":{"observed_at":"2026-08-06T12:53:11.039296Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2303.02794","last_updated":"2023-03-05T23:01:02Z","snapshot_observed_at":"2026-08-05T20:39:20.097228Z","submitted_at":"2023-03-05T23:01:02Z","title":"CoRTX: Contrastive Framework for Real-time Explanation","version":1},"cited_work":{"arxiv_id":"2303.02794","doi":null,"metadata_source":"pith","pith_arxiv_id":"2303.02794","snapshot_observed_at":"2026-08-06T12:53:11.471804Z","title":"CoRTX: Contrastive Framework for Real-time Explanation","venue":"cs.LG","work_id":"91c53fb1-5f55-40e4-80c5-7f6ddccd5fe7","year":2023},"citing_paper":{"arxiv_id":"2507.21395","last_updated":"2025-07-29T00:03:28Z","snapshot_observed_at":"2026-08-06T12:53:09.509235Z","submitted_at":"2025-07-29T00:03:28Z","title":"Sync-TVA: A Graph-Attention Framework for Multimodal Emotion Recognition with Cross-Modal Fusion","version":1},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-08-06T12:53:11.050662Z"},"links":{"cited_paper":"/paper/2303.02794","citing_paper":"/paper/2507.21395"},"observation_digest":"sha256:68bfe74bc0700c41e02331c233150c6d2ea78092b6774733ad53484461134185","observation_id":"169c8c2d-444e-4ddf-9aed-d586519c2cfd","resolution":{"observed_at":"2026-08-06T12:53:11.498118Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1904.04446","last_updated":"2019-04-09T03:25:53Z","snapshot_observed_at":"2026-07-06T07:44:51.580206Z","submitted_at":"2019-04-09T03:25:53Z","title":"HiGRU: Hierarchical Gated Recurrent Units for Utterance-level Emotion Recognition","version":1},"cited_work":{"arxiv_id":"1904.04446","doi":null,"metadata_source":"pith","pith_arxiv_id":"1904.04446","snapshot_observed_at":"2026-08-06T12:53:11.401465Z","title":"HiGRU: Hierarchical Gated Recurrent Units for Utterance-level Emotion Recognition","venue":"cs.CL","work_id":"37c4ae79-af0d-471c-a686-52f761e7c7dc","year":2019},"citing_paper":{"arxiv_id":"2507.21395","last_updated":"2025-07-29T00:03:28Z","snapshot_observed_at":"2026-08-06T12:53:09.509235Z","submitted_at":"2025-07-29T00:03:28Z","title":"Sync-TVA: A Graph-Attention Framework for Multimodal Emotion Recognition with Cross-Modal Fusion","version":1},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-08-06T12:53:11.056219Z"},"links":{"cited_paper":"/paper/1904.04446","citing_paper":"/paper/2507.21395"},"observation_digest":"sha256:9b2ec895311a89a48fe0f4bb6e834fe0bee1e397b4b08329aacf93fceb8973b2","observation_id":"a80d9179-f257-431c-9eac-55c85c46a171","resolution":{"observed_at":"2026-08-06T12:53:11.436791Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T12:53:11.860036Z","title":"Semantic-emotion neural network for emotion recognition from text,","venue":null,"work_id":"80c49746-cdc4-4b42-94b0-7f85da1c139c","year":2019},"citing_paper":{"arxiv_id":"2507.21395","last_updated":"2025-07-29T00:03:28Z","snapshot_observed_at":"2026-08-06T12:53:09.509235Z","submitted_at":"2025-07-29T00:03:28Z","title":"Sync-TVA: A Graph-Attention Framework for Multimodal Emotion Recognition with Cross-Modal Fusion","version":1},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-08-06T12:53:11.062074Z"},"links":{"citing_paper":"/paper/2507.21395"},"observation_digest":"sha256:9d93a942eedc7e57cfdd9914786049df7fa9ac4901df12ee98ee2247651c47bf","observation_id":"ab587487-9456-4776-b6f8-1d525a36421f","resolution":{"observed_at":"2026-08-06T12:53:11.865238Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T12:53:11.844064Z","title":"Aspect-based sen- timent analysis via affective knowledge enhanced graph convolutional networks,","venue":null,"work_id":"37320426-6e43-4b20-bc5e-00a592a798e1","year":2022},"citing_paper":{"arxiv_id":"2507.21395","last_updated":"2025-07-29T00:03:28Z","snapshot_observed_at":"2026-08-06T12:53:09.509235Z","submitted_at":"2025-07-29T00:03:28Z","title":"Sync-TVA: A Graph-Attention Framework for Multimodal Emotion Recognition with Cross-Modal Fusion","version":1},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-08-06T12:53:11.067483Z"},"links":{"citing_paper":"/paper/2507.21395"},"observation_digest":"sha256:9839613a2545aaae6bf1e3d7db802d1af8baa6e28cc5aca5d090a0853a065204","observation_id":"89067538-fa8a-4651-b22f-8d0e6ab4cf1a","resolution":{"observed_at":"2026-08-06T12:53:11.849544Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T12:53:11.827927Z","title":"Graph con- volutional network with multiple weight mechanisms for aspect-based sentiment analysis,","venue":null,"work_id":"7c604e18-d445-4f94-9560-7250c6a48816","year":2022},"citing_paper":{"arxiv_id":"2507.21395","last_updated":"2025-07-29T00:03:28Z","snapshot_observed_at":"2026-08-06T12:53:09.509235Z","submitted_at":"2025-07-29T00:03:28Z","title":"Sync-TVA: A Graph-Attention Framework for Multimodal Emotion Recognition with Cross-Modal Fusion","version":1},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-08-06T12:53:11.074281Z"},"links":{"citing_paper":"/paper/2507.21395"},"observation_digest":"sha256:6f8940fa6b730f1e7bcd28c885bf947e511ee2ab445f8f5057f6758924ea6f57","observation_id":"4b084878-66c3-41de-90c4-8b679062a101","resolution":{"observed_at":"2026-08-06T12:53:11.833172Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T12:53:11.810431Z","title":"Multimodal emotion recognition in polish (student consortium),","venue":null,"work_id":"376e12ce-b8da-412f-952c-d0d1f1c0b163","year":2020},"citing_paper":{"arxiv_id":"2507.21395","last_updated":"2025-07-29T00:03:28Z","snapshot_observed_at":"2026-08-06T12:53:09.509235Z","submitted_at":"2025-07-29T00:03:28Z","title":"Sync-TVA: A Graph-Attention Framework for Multimodal Emotion Recognition with Cross-Modal Fusion","version":1},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-08-06T12:53:11.079139Z"},"links":{"citing_paper":"/paper/2507.21395"},"observation_digest":"sha256:a6d2dc440ccc03ae33d7dc6844077f361c4bbef9414c056461604f49b863d63d","observation_id":"da61e49f-3a51-46bb-bd13-4591c95c61ca","resolution":{"observed_at":"2026-08-06T12:53:11.815309Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T12:53:11.793833Z","title":"Cfn-esa: A cross-modal fusion network with emotion-shift awareness for dialogue emotion recognition,","venue":null,"work_id":"d2fcc23d-f45e-4765-960d-ba2c10fb60e0","year":2024},"citing_paper":{"arxiv_id":"2507.21395","last_updated":"2025-07-29T00:03:28Z","snapshot_observed_at":"2026-08-06T12:53:09.509235Z","submitted_at":"2025-07-29T00:03:28Z","title":"Sync-TVA: A Graph-Attention Framework for Multimodal Emotion Recognition with Cross-Modal Fusion","version":1},"reference_index":36,"source":"pdf_text","source_observed_at":"2026-08-06T12:53:11.084367Z"},"links":{"citing_paper":"/paper/2507.21395"},"observation_digest":"sha256:617497c46d1a19e4a042175a7f86c3ad49e45b91594f8b00bb33b50865120e5e","observation_id":"f8ef073a-2ec8-4249-9010-4df1e551b7b3","resolution":{"observed_at":"2026-08-06T12:53:11.799257Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T12:53:11.775878Z","title":"Multi-modal emotion recognition in conversation based on prompt learning with text-audio fusion features,","venue":null,"work_id":"7c5aa5d4-737b-44c0-a4a9-5468fac65e31","year":2025},"citing_paper":{"arxiv_id":"2507.21395","last_updated":"2025-07-29T00:03:28Z","snapshot_observed_at":"2026-08-06T12:53:09.509235Z","submitted_at":"2025-07-29T00:03:28Z","title":"Sync-TVA: A Graph-Attention Framework for Multimodal Emotion Recognition with Cross-Modal Fusion","version":1},"reference_index":37,"source":"pdf_text","source_observed_at":"2026-08-06T12:53:11.091821Z"},"links":{"citing_paper":"/paper/2507.21395"},"observation_digest":"sha256:dab93f4434bdb3022981efc1e32c6e406f4e2f8864915272ca6788b9354f8fd6","observation_id":"48e87261-9aef-4224-af2f-158fe7d7ef14","resolution":{"observed_at":"2026-08-06T12:53:11.781257Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1908.11540","last_updated":"2019-08-30T05:44:24Z","snapshot_observed_at":"2026-08-10T02:18:19.197213Z","submitted_at":"2019-08-30T05:44:24Z","title":"DialogueGCN: A Graph Convolutional Neural Network for Emotion Recognition in Conversation","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1908.11540","snapshot_observed_at":"2026-08-06T12:53:11.097917Z","title":"Dia- loguegcn: A graph convolutional neural network for emotion recognition in conversation,","venue":null,"work_id":null,"year":1908},"citing_paper":{"arxiv_id":"2507.21395","last_updated":"2025-07-29T00:03:28Z","snapshot_observed_at":"2026-08-06T12:53:09.509235Z","submitted_at":"2025-07-29T00:03:28Z","title":"Sync-TVA: A Graph-Attention Framework for Multimodal Emotion Recognition with Cross-Modal Fusion","version":1},"reference_index":38,"source":"pdf_text","source_observed_at":"2026-08-06T12:53:11.097917Z"},"links":{"cited_paper":"/paper/1908.11540","citing_paper":"/paper/2507.21395"},"observation_digest":"sha256:e305ad668f2b56c2fd0461fe8cfe045352746d84f447a5a59d1e3a7e76cfb5cd","observation_id":"677edfdc-a92f-4841-8db8-4b9bc47f269b","resolution":{"observed_at":"2026-08-06T12:53:11.097917Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T12:53:11.759450Z","title":"Rgat: A deeper look into syntactic dependency information for coreference resolution,","venue":null,"work_id":"0a142e98-9782-4795-9178-02df70dcfe5c","year":2023},"citing_paper":{"arxiv_id":"2507.21395","last_updated":"2025-07-29T00:03:28Z","snapshot_observed_at":"2026-08-06T12:53:09.509235Z","submitted_at":"2025-07-29T00:03:28Z","title":"Sync-TVA: A Graph-Attention Framework for Multimodal Emotion Recognition with Cross-Modal Fusion","version":1},"reference_index":39,"source":"pdf_text","source_observed_at":"2026-08-06T12:53:11.104682Z"},"links":{"citing_paper":"/paper/2507.21395"},"observation_digest":"sha256:2f76649f0c471bd17025dbd9fe6e56fd02fef1e6da6836272dac61c1740a3f55","observation_id":"edb16290-4309-4446-b2ca-593d782ba975","resolution":{"observed_at":"2026-08-06T12:53:11.764756Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T12:53:11.739778Z","title":"Sdr-gnn: Spectral domain reconstruction graph neural network for incomplete multimodal learning in conversational emotion recognition,","venue":null,"work_id":"e57cb53c-a480-461d-a755-275dba80c46f","year":2025},"citing_paper":{"arxiv_id":"2507.21395","last_updated":"2025-07-29T00:03:28Z","snapshot_observed_at":"2026-08-06T12:53:09.509235Z","submitted_at":"2025-07-29T00:03:28Z","title":"Sync-TVA: A Graph-Attention Framework for Multimodal Emotion Recognition with Cross-Modal Fusion","version":1},"reference_index":40,"source":"pdf_text","source_observed_at":"2026-08-06T12:53:11.110038Z"},"links":{"citing_paper":"/paper/2507.21395"},"observation_digest":"sha256:9b03098a22f1db256694dafb9efba923d8583ab6e6df29430d344b94090fa3c1","observation_id":"0f8b2911-fa91-4443-96a5-125faa4cfd51","resolution":{"observed_at":"2026-08-06T12:53:11.745394Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T12:53:11.722893Z","title":"Multivariate, multi-frequency and multimodal: Rethinking graph neural networks for emotion recog- nition in conversation,","venue":null,"work_id":"d5ffbb59-cc01-49ab-bacc-4b3752fd7c1c","year":2023},"citing_paper":{"arxiv_id":"2507.21395","last_updated":"2025-07-29T00:03:28Z","snapshot_observed_at":"2026-08-06T12:53:09.509235Z","submitted_at":"2025-07-29T00:03:28Z","title":"Sync-TVA: A Graph-Attention Framework for Multimodal Emotion Recognition with Cross-Modal Fusion","version":1},"reference_index":41,"source":"pdf_text","source_observed_at":"2026-08-06T12:53:11.115173Z"},"links":{"citing_paper":"/paper/2507.21395"},"observation_digest":"sha256:c0aca1475b2e6c1b032dde797d9208937db3a440b8e415eae44d7aee147aab59","observation_id":"7c3f5814-5af2-423a-a201-cfc314beca45","resolution":{"observed_at":"2026-08-06T12:53:11.728041Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T12:53:11.705273Z","title":"Multimodal decoupled dis- tillation graph neural network for emotion recognition in conversation,","venue":null,"work_id":"84641018-9d0e-495e-b8c1-2c31582eb720","year":2024},"citing_paper":{"arxiv_id":"2507.21395","last_updated":"2025-07-29T00:03:28Z","snapshot_observed_at":"2026-08-06T12:53:09.509235Z","submitted_at":"2025-07-29T00:03:28Z","title":"Sync-TVA: A Graph-Attention Framework for Multimodal Emotion Recognition with Cross-Modal Fusion","version":1},"reference_index":42,"source":"pdf_text","source_observed_at":"2026-08-06T12:53:11.120242Z"},"links":{"citing_paper":"/paper/2507.21395"},"observation_digest":"sha256:55f09590e6994e70169a4007b7122c253a1585190a167c5d73805bc1a8972fd7","observation_id":"425a2f1c-c3a1-43a3-86b5-296ecd61946e","resolution":{"observed_at":"2026-08-06T12:53:11.711607Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T12:53:11.686922Z","title":"Conversational memory network for emotion recognition in dyadic dialogue videos,","venue":null,"work_id":"e1e0ee5f-ac3f-49d9-bcec-5b7b9e461585","year":2018},"citing_paper":{"arxiv_id":"2507.21395","last_updated":"2025-07-29T00:03:28Z","snapshot_observed_at":"2026-08-06T12:53:09.509235Z","submitted_at":"2025-07-29T00:03:28Z","title":"Sync-TVA: A Graph-Attention Framework for Multimodal Emotion Recognition with Cross-Modal Fusion","version":1},"reference_index":43,"source":"pdf_text","source_observed_at":"2026-08-06T12:53:11.125664Z"},"links":{"citing_paper":"/paper/2507.21395"},"observation_digest":"sha256:ac9e1f0ac45f5fbdc9e6337d2033954c2e5b494600f224d4b62a25ec929b2333","observation_id":"688134a8-235c-436a-af76-d40ba9c6095d","resolution":{"observed_at":"2026-08-06T12:53:11.692640Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T12:53:11.665819Z","title":"Icon: Interactive conversational memory network for multimodal emo- tion detection,","venue":null,"work_id":"d69aa755-5779-4789-8de9-262f9830b587","year":2018},"citing_paper":{"arxiv_id":"2507.21395","last_updated":"2025-07-29T00:03:28Z","snapshot_observed_at":"2026-08-06T12:53:09.509235Z","submitted_at":"2025-07-29T00:03:28Z","title":"Sync-TVA: A Graph-Attention Framework for Multimodal Emotion Recognition with Cross-Modal Fusion","version":1},"reference_index":44,"source":"pdf_text","source_observed_at":"2026-08-06T12:53:11.131591Z"},"links":{"citing_paper":"/paper/2507.21395"},"observation_digest":"sha256:590bb70a37fc68177c9e5dac62e6342447a2dcd3e207c41bb3b1a17ae4c05e2b","observation_id":"d1a4b21c-722d-4341-90e9-c9c8bd3507f3","resolution":{"observed_at":"2026-08-06T12:53:11.671898Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T12:53:11.647190Z","title":"Dialoguernn: An attentive rnn for emotion detection in conversations,","venue":null,"work_id":"b89495cd-eb82-465f-85ed-4c9bec45922f","year":2019},"citing_paper":{"arxiv_id":"2507.21395","last_updated":"2025-07-29T00:03:28Z","snapshot_observed_at":"2026-08-06T12:53:09.509235Z","submitted_at":"2025-07-29T00:03:28Z","title":"Sync-TVA: A Graph-Attention Framework for Multimodal Emotion Recognition with Cross-Modal Fusion","version":1},"reference_index":45,"source":"pdf_text","source_observed_at":"2026-08-06T12:53:11.137184Z"},"links":{"citing_paper":"/paper/2507.21395"},"observation_digest":"sha256:8e9fc77f33c261518594e26270728fa984af2d70b13a06a681cd98287f6b6ce4","observation_id":"0f6e0ed8-cb3e-4326-95a8-f3fb5f47e249","resolution":{"observed_at":"2026-08-06T12:53:11.652544Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T12:53:11.629736Z","title":"Dialoguecrn: Contextual reasoning net- works for emotion recognition in conversations,","venue":null,"work_id":"f035bd3e-06ff-427d-866c-be836b91bd8b","year":2021},"citing_paper":{"arxiv_id":"2507.21395","last_updated":"2025-07-29T00:03:28Z","snapshot_observed_at":"2026-08-06T12:53:09.509235Z","submitted_at":"2025-07-29T00:03:28Z","title":"Sync-TVA: A Graph-Attention Framework for Multimodal Emotion Recognition with Cross-Modal Fusion","version":1},"reference_index":46,"source":"pdf_text","source_observed_at":"2026-08-06T12:53:11.142390Z"},"links":{"citing_paper":"/paper/2507.21395"},"observation_digest":"sha256:a3df2d14bcb8779156f46edbe06904e3c97552c08e2c7a8449df6ffc7b5e3a52","observation_id":"eed97ed0-7c05-4392-b80a-0152c75c08dd","resolution":{"observed_at":"2026-08-06T12:53:11.634776Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2107.06779","last_updated":"2021-07-14T15:37:02Z","snapshot_observed_at":"2026-07-06T11:29:07.489964Z","submitted_at":"2021-07-14T15:37:02Z","title":"MMGCN: Multimodal Fusion via Deep Graph Convolution Network for Emotion Recognition in Conversation","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2107.06779","snapshot_observed_at":"2026-08-06T12:53:11.147490Z","title":"Mmgcn: Multimodal fusion via deep graph convolution network for emotion recognition in conversation,","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2507.21395","last_updated":"2025-07-29T00:03:28Z","snapshot_observed_at":"2026-08-06T12:53:09.509235Z","submitted_at":"2025-07-29T00:03:28Z","title":"Sync-TVA: A Graph-Attention Framework for Multimodal Emotion Recognition with Cross-Modal Fusion","version":1},"reference_index":47,"source":"pdf_text","source_observed_at":"2026-08-06T12:53:11.147490Z"},"links":{"cited_paper":"/paper/2107.06779","citing_paper":"/paper/2507.21395"},"observation_digest":"sha256:b8b3cd0593487de51c76157965605c543a9f8ba5c70303c2f634ae9a824b2a96","observation_id":"48734d00-832a-4382-91c4-c3c610710c6c","resolution":{"observed_at":"2026-08-06T12:53:11.147490Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2205.02455","last_updated":"2022-05-05T05:54:24Z","snapshot_observed_at":"2026-08-08T19:21:07.625448Z","submitted_at":"2022-05-05T05:54:24Z","title":"COGMEN: COntextualized GNN based Multimodal Emotion recognitioN","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2205.02455","snapshot_observed_at":"2026-08-06T12:53:11.153551Z","title":"Cogmen: Con- textualized gnn based multimodal emotion recognition,","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2507.21395","last_updated":"2025-07-29T00:03:28Z","snapshot_observed_at":"2026-08-06T12:53:09.509235Z","submitted_at":"2025-07-29T00:03:28Z","title":"Sync-TVA: A Graph-Attention Framework for Multimodal Emotion Recognition with Cross-Modal Fusion","version":1},"reference_index":48,"source":"pdf_text","source_observed_at":"2026-08-06T12:53:11.153551Z"},"links":{"cited_paper":"/paper/2205.02455","citing_paper":"/paper/2507.21395"},"observation_digest":"sha256:fa5dfaedf002a21366e38a7dfe1bb297062b1e9ca44e900a3aebe393eeb0bf90","observation_id":"97c2495c-ea7d-4338-8bb3-b08d44e21a60","resolution":{"observed_at":"2026-08-06T12:53:11.153551Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T12:53:11.613999Z","title":"Joyful: Joint modality fusion and graph contrastive learning for multimoda emotion recogni- tion,","venue":null,"work_id":"b74e0ac4-f5e1-4bf0-9549-28d5d0d003ed","year":2023},"citing_paper":{"arxiv_id":"2507.21395","last_updated":"2025-07-29T00:03:28Z","snapshot_observed_at":"2026-08-06T12:53:09.509235Z","submitted_at":"2025-07-29T00:03:28Z","title":"Sync-TVA: A Graph-Attention Framework for Multimodal Emotion Recognition with Cross-Modal Fusion","version":1},"reference_index":49,"source":"pdf_text","source_observed_at":"2026-08-06T12:53:11.160990Z"},"links":{"citing_paper":"/paper/2507.21395"},"observation_digest":"sha256:6bdd09916e4380046a93b26d5e98c056c73cfadd4995ddf952fbeb5f3c535205","observation_id":"acd776cb-244c-40e1-898d-f48b2ccdd938","resolution":{"observed_at":"2026-08-06T12:53:11.618699Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T12:53:11.596236Z","title":"Mm-dfn: Multimodal dynamic fusion network for emotion recognition in conversations,","venue":null,"work_id":"135df4a3-cac4-429c-97bf-34d4f03db8d1","year":2022},"citing_paper":{"arxiv_id":"2507.21395","last_updated":"2025-07-29T00:03:28Z","snapshot_observed_at":"2026-08-06T12:53:09.509235Z","submitted_at":"2025-07-29T00:03:28Z","title":"Sync-TVA: A Graph-Attention Framework for Multimodal Emotion Recognition with Cross-Modal Fusion","version":1},"reference_index":50,"source":"pdf_text","source_observed_at":"2026-08-06T12:53:11.169474Z"},"links":{"citing_paper":"/paper/2507.21395"},"observation_digest":"sha256:37fd74a0932f729e64ea7c90590d3b2b98df7703847012aff038d710a472f8e6","observation_id":"e2636b35-446e-4625-b11b-88d073e4820a","resolution":{"observed_at":"2026-08-06T12:53:11.601653Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2407.21536","last_updated":"2025-06-29T16:49:43Z","snapshot_observed_at":"2026-08-09T17:53:13.464299Z","submitted_at":"2024-07-31T11:47:36Z","title":"Tracing Intricate Cues in Dialogue: Joint Graph Structure and Sentiment Dynamics for Multimodal Emotion Recognition","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2407.21536","snapshot_observed_at":"2026-08-06T12:53:11.175855Z","title":"Tracing intricate cues in dialogue: Joint graph structure and sentiment dynamics for multimodal emotion recognition,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.21395","last_updated":"2025-07-29T00:03:28Z","snapshot_observed_at":"2026-08-06T12:53:09.509235Z","submitted_at":"2025-07-29T00:03:28Z","title":"Sync-TVA: A Graph-Attention Framework for Multimodal Emotion Recognition with Cross-Modal Fusion","version":1},"reference_index":51,"source":"pdf_text","source_observed_at":"2026-08-06T12:53:11.175855Z"},"links":{"cited_paper":"/paper/2407.21536","citing_paper":"/paper/2507.21395"},"observation_digest":"sha256:5d003aac21eecd9ff1646e3a8c4ef164ffe5196f3a045d9b15bfe2d8abe18bfd","observation_id":"0f0a91bb-705f-4b83-a70e-9e535d353e90","resolution":{"observed_at":"2026-08-06T12:53:11.175855Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T12:53:11.564965Z","title":"Der-gcn: Dialog and event relation-aware graph convolutional neural network for multimodal dialog emotion recognition,","venue":null,"work_id":"376b5609-8577-4e25-abd4-65fed1418dbf","year":2024},"citing_paper":{"arxiv_id":"2507.21395","last_updated":"2025-07-29T00:03:28Z","snapshot_observed_at":"2026-08-06T12:53:09.509235Z","submitted_at":"2025-07-29T00:03:28Z","title":"Sync-TVA: A Graph-Attention Framework for Multimodal Emotion Recognition with Cross-Modal Fusion","version":1},"reference_index":52,"source":"pdf_text","source_observed_at":"2026-08-06T12:53:11.184214Z"},"links":{"citing_paper":"/paper/2507.21395"},"observation_digest":"sha256:d32aace36392258250fe47af8c883df4f48d589a1d8c45479024ce9d75cd4f0a","observation_id":"c1fbbc7a-3af7-434c-ac16-c780053d887b","resolution":{"observed_at":"2026-08-06T12:53:11.582914Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2306.01505","last_updated":"2023-07-09T23:27:27Z","snapshot_observed_at":"2026-07-06T15:37:08.613825Z","submitted_at":"2023-06-02T12:52:38Z","title":"Supervised Adversarial Contrastive Learning for Emotion Recognition in Conversations","version":2},"cited_work":{"arxiv_id":"2306.01505","doi":null,"metadata_source":"pith","pith_arxiv_id":"2306.01505","snapshot_observed_at":"2026-08-06T12:53:11.248215Z","title":"Supervised Adversarial Contrastive Learning for Emotion Recognition in Conversations","venue":"cs.CL","work_id":"a8b0af65-0bb7-4bdc-a74f-6c9f55ab956a","year":2023},"citing_paper":{"arxiv_id":"2507.21395","last_updated":"2025-07-29T00:03:28Z","snapshot_observed_at":"2026-08-06T12:53:09.509235Z","submitted_at":"2025-07-29T00:03:28Z","title":"Sync-TVA: A Graph-Attention Framework for Multimodal Emotion Recognition with Cross-Modal Fusion","version":1},"reference_index":53,"source":"pdf_text","source_observed_at":"2026-08-06T12:53:11.190273Z"},"links":{"cited_paper":"/paper/2306.01505","citing_paper":"/paper/2507.21395"},"observation_digest":"sha256:4aac81f1dcc35a0c1fc269558238603f37893636e630073b0ffb9f615bda0360","observation_id":"639c7448-3776-446a-bf7a-7c29b9cf2ed6","resolution":{"observed_at":"2026-08-06T12:53:11.258925Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}}],"paper":{"arxiv_id":"2507.21395","last_updated":"2025-07-29T00:03:28Z","latest_version":1,"primary_category":"cs.MM","snapshot_observed_at":"2026-08-06T12:53:09.509235Z","submitted_at":"2025-07-29T00:03:28Z","title":"Sync-TVA: A Graph-Attention Framework for Multimodal Emotion Recognition with Cross-Modal Fusion"},"reference_resolution":{"displayed":53,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":6,"verified_exact":3,"verified_fuzzy":44},"total_outbound_references":53},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"thesis":"As of 10 August 2026, this Paper Citation Record lists 53 of 53 outbound references and 0 inbound Pith citation observations for arXiv:2507.21395."}