{"as_of":"2026-08-15T08:58:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:3767684c084dd21d8b34e4925a57be89f39a6b8c96dac2b2af305870c298931b","coverage":[{"denominator":35,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":35,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-10T14:43:42.168958Z","state":"measured"},{"denominator":36,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":36,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-15T06:32:42.880941+00:00","state":"measured"},{"denominator":1,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":1,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-07T13:56:45.896590Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2501.15063","last_updated":"2025-01-25T03:53:53Z","snapshot_observed_at":"2026-08-10T14:37:11.157983Z","submitted_at":"2025-01-25T03:53:53Z","title":"Cross-modal Context Fusion and Adaptive Graph Convolutional Network for Multimodal Conversational Emotion Recognition","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2501.15063","snapshot_observed_at":"2026-08-07T13:56:45.896590Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2505.20511","last_updated":"2025-09-09T06:34:44Z","snapshot_observed_at":"2026-08-14T04:38:04.196386Z","submitted_at":"2025-05-26T20:23:24Z","title":"Multimodal Emotion Recognition in Conversations: A Survey of Methods, Trends, Challenges and Prospects","version":2},"reference_index":25,"source":"arxiv_source","source_observed_at":"2026-08-07T13:56:45.896590Z"},"links":{"cited_paper":"/paper/2501.15063","citing_paper":"/paper/2505.20511"},"observation_digest":"sha256:44d5dcecf4cd890cc77469eebdccbd6437795c79b58cfad7a0f4ce008fb0aa46","observation_id":"c08c528f-3abb-43e8-97f9-8ef52a15dd22","resolution":{"observed_at":"2026-08-07T13:56:45.896590Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"links":{"evidence":"/evidence","html":"/paper/2501.15063/citation-record","integrity":"/paper/2501.15063/integrity","json":"/paper/2501.15063/citation-record.json","paper":"/paper/2501.15063"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T14:43:43.582690Z","title":"Erc dmsp: Emotion recognition in conversation based on dynamic modeling of speaker personalities,","venue":null,"work_id":"1d32f0f5-65dc-4dc3-abb3-54c52ba7e839","year":2024},"citing_paper":{"arxiv_id":"2501.15063","last_updated":"2025-01-25T03:53:53Z","snapshot_observed_at":"2026-08-10T14:37:11.157983Z","submitted_at":"2025-01-25T03:53:53Z","title":"Cross-modal Context Fusion and Adaptive Graph Convolutional Network for Multimodal Conversational Emotion Recognition","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-10T14:43:41.583718Z"},"links":{"citing_paper":"/paper/2501.15063"},"observation_digest":"sha256:10cd25ae6233a1a6403bac04b557b077f991d235ac576f10d298a137aa6bcb41","observation_id":"2f250034-acdf-4258-826f-0d1b7b1bea49","resolution":{"observed_at":"2026-08-10T14:43:43.586229Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T14:43:43.572850Z","title":"Modeling sentiment-speaker- dependency for emotion recognition in conversation,","venue":null,"work_id":"18c88940-5a40-49c1-b431-5583bbc404ef","year":2024},"citing_paper":{"arxiv_id":"2501.15063","last_updated":"2025-01-25T03:53:53Z","snapshot_observed_at":"2026-08-10T14:37:11.157983Z","submitted_at":"2025-01-25T03:53:53Z","title":"Cross-modal Context Fusion and Adaptive Graph Convolutional Network for Multimodal Conversational Emotion Recognition","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-10T14:43:41.652606Z"},"links":{"citing_paper":"/paper/2501.15063"},"observation_digest":"sha256:da640ef62df4ff2c92061f9e15626e4fa9fb4f845f88368630b5015338c23543","observation_id":"83b3bf19-bfda-492c-97ec-3412b483b257","resolution":{"observed_at":"2026-08-10T14:43:43.576430Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T14:43:43.562172Z","title":"D-man: a distance- based multi-channel attention network for erc,","venue":null,"work_id":"2c4add46-bf31-432a-97ae-035334c2ccd1","year":2024},"citing_paper":{"arxiv_id":"2501.15063","last_updated":"2025-01-25T03:53:53Z","snapshot_observed_at":"2026-08-10T14:37:11.157983Z","submitted_at":"2025-01-25T03:53:53Z","title":"Cross-modal Context Fusion and Adaptive Graph Convolutional Network for Multimodal Conversational Emotion Recognition","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-10T14:43:41.697708Z"},"links":{"citing_paper":"/paper/2501.15063"},"observation_digest":"sha256:2180bde73edc0dd3e69e2e58b6d2c6014ee93d4c78c9a52b25daac2b38ba8766","observation_id":"a8e09736-86c9-48da-9674-04b6f307f4b4","resolution":{"observed_at":"2026-08-10T14:43:43.566005Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T14:43:43.549239Z","title":"Ctf-erc: Coarse-to-fine rea- soning for emotion recognition in conversations,","venue":null,"work_id":"b5eb70f9-be67-4753-96d0-4f942d9a6ad6","year":2024},"citing_paper":{"arxiv_id":"2501.15063","last_updated":"2025-01-25T03:53:53Z","snapshot_observed_at":"2026-08-10T14:37:11.157983Z","submitted_at":"2025-01-25T03:53:53Z","title":"Cross-modal Context Fusion and Adaptive Graph Convolutional Network for Multimodal Conversational Emotion Recognition","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-10T14:43:41.702698Z"},"links":{"citing_paper":"/paper/2501.15063"},"observation_digest":"sha256:420aa3d7c623d5d429a7e193b57c382607aabf4e27c001a944e8484537436e85","observation_id":"d12cb769-63eb-4d26-af57-bdd58d86a80e","resolution":{"observed_at":"2026-08-10T14:43:43.555337Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T14:43:43.534796Z","title":"Deep learning approaches for effective human computer interaction: A comprehensive survey on single and multimodal emotion detection,","venue":null,"work_id":"9442ac96-70f4-407b-98a8-b84de6b3c926","year":2024},"citing_paper":{"arxiv_id":"2501.15063","last_updated":"2025-01-25T03:53:53Z","snapshot_observed_at":"2026-08-10T14:37:11.157983Z","submitted_at":"2025-01-25T03:53:53Z","title":"Cross-modal Context Fusion and Adaptive Graph Convolutional Network for Multimodal Conversational Emotion Recognition","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-10T14:43:41.707253Z"},"links":{"citing_paper":"/paper/2501.15063"},"observation_digest":"sha256:c2628b611fa60b530f6a89f109c77b5b90ba5adcff400558715c60e9272a7bf8","observation_id":"5bef658f-a64f-4183-a9ec-826939752a62","resolution":{"observed_at":"2026-08-10T14:43:43.542305Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T14:43:43.524868Z","title":"Deep learning in digital marketing: brand detection and emotion recognition,","venue":null,"work_id":"bd10c76e-bbff-42a7-8584-98ff3c97a398","year":2017},"citing_paper":{"arxiv_id":"2501.15063","last_updated":"2025-01-25T03:53:53Z","snapshot_observed_at":"2026-08-10T14:37:11.157983Z","submitted_at":"2025-01-25T03:53:53Z","title":"Cross-modal Context Fusion and Adaptive Graph Convolutional Network for Multimodal Conversational Emotion Recognition","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-10T14:43:41.714089Z"},"links":{"citing_paper":"/paper/2501.15063"},"observation_digest":"sha256:b4ba919e3a34eb0f6fd87604b55303671c248d27238af839ae7d496d4e97a99b","observation_id":"72f6f8c0-f698-4b3d-9706-b3736f02e8ab","resolution":{"observed_at":"2026-08-10T14:43:43.528601Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T14:43:43.426441Z","title":"Cnn based face emotion recognition system for healthcare application,","venue":null,"work_id":"d0639581-2ee8-4f5f-b3ac-d7a83fb68ebb","year":2024},"citing_paper":{"arxiv_id":"2501.15063","last_updated":"2025-01-25T03:53:53Z","snapshot_observed_at":"2026-08-10T14:37:11.157983Z","submitted_at":"2025-01-25T03:53:53Z","title":"Cross-modal Context Fusion and Adaptive Graph Convolutional Network for Multimodal Conversational Emotion Recognition","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-10T14:43:41.719483Z"},"links":{"citing_paper":"/paper/2501.15063"},"observation_digest":"sha256:b68ebbff0bb7943d5391572ea16fa1023cb9f92c5df30466b27c60818bee91bc","observation_id":"f28f388b-259f-44fd-8340-034a55533d53","resolution":{"observed_at":"2026-08-10T14:43:43.495890Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T14:43:43.349425Z","title":"Emotion recognition and artificial intelligence: A systematic review (2014–2023) and research recommendations,","venue":null,"work_id":"47a17bbc-8089-441f-9c62-f984296f549f","year":2014},"citing_paper":{"arxiv_id":"2501.15063","last_updated":"2025-01-25T03:53:53Z","snapshot_observed_at":"2026-08-10T14:37:11.157983Z","submitted_at":"2025-01-25T03:53:53Z","title":"Cross-modal Context Fusion and Adaptive Graph Convolutional Network for Multimodal Conversational Emotion Recognition","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-10T14:43:41.723844Z"},"links":{"citing_paper":"/paper/2501.15063"},"observation_digest":"sha256:0d333744c20168ac2d32485569bc23032afeba40fdb6a0ca7cf0609f96f76fec","observation_id":"ebe8dec2-6fa8-414b-a4d0-bd5475d8a639","resolution":{"observed_at":"2026-08-10T14:43:43.388013Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T14:43:43.253483Z","title":"Multimodal emotion recognition with deep learning: advancements, challenges, and future directions,","venue":null,"work_id":"cee26d01-10d0-4175-94fb-da7591389b77","year":2024},"citing_paper":{"arxiv_id":"2501.15063","last_updated":"2025-01-25T03:53:53Z","snapshot_observed_at":"2026-08-10T14:37:11.157983Z","submitted_at":"2025-01-25T03:53:53Z","title":"Cross-modal Context Fusion and Adaptive Graph Convolutional Network for Multimodal Conversational Emotion Recognition","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-10T14:43:41.727840Z"},"links":{"citing_paper":"/paper/2501.15063"},"observation_digest":"sha256:f1730e0200ba45115793e7c0c7cda552c2a916642a859706906dfa6c27cc13d5","observation_id":"0da28bd0-9f51-452d-b0f4-915405dfd82b","resolution":{"observed_at":"2026-08-10T14:43:43.300592Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T14:43:43.213694Z","title":"Enhancing aerial object detec- tion with selective frequency interaction network,","venue":null,"work_id":"6da1f3e8-8bbd-4aca-bc36-9113dc85e300","year":2024},"citing_paper":{"arxiv_id":"2501.15063","last_updated":"2025-01-25T03:53:53Z","snapshot_observed_at":"2026-08-10T14:37:11.157983Z","submitted_at":"2025-01-25T03:53:53Z","title":"Cross-modal Context Fusion and Adaptive Graph Convolutional Network for Multimodal Conversational Emotion Recognition","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-10T14:43:41.731584Z"},"links":{"citing_paper":"/paper/2501.15063"},"observation_digest":"sha256:23cc3320bfa19c6872062294e00638144d4ba494b3ce22fb3dac3d8370d9caa7","observation_id":"9b6653dd-112f-426e-8ea9-950ec0b1e79e","resolution":{"observed_at":"2026-08-10T14:43:43.217819Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2404.01614","last_updated":"2024-04-02T03:36:07Z","snapshot_observed_at":"2026-08-13T00:39:38.534689Z","submitted_at":"2024-04-02T03:36:07Z","title":"LR-FPN: Enhancing Remote Sensing Object Detection with Location Refined Feature Pyramid Network","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2404.01614","snapshot_observed_at":"2026-08-10T14:43:41.767831Z","title":"Lr-fpn: Enhancing remote sensing object detection with location refined feature pyramid network,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2501.15063","last_updated":"2025-01-25T03:53:53Z","snapshot_observed_at":"2026-08-10T14:37:11.157983Z","submitted_at":"2025-01-25T03:53:53Z","title":"Cross-modal Context Fusion and Adaptive Graph Convolutional Network for Multimodal Conversational Emotion Recognition","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-10T14:43:41.767831Z"},"links":{"cited_paper":"/paper/2404.01614","citing_paper":"/paper/2501.15063"},"observation_digest":"sha256:a09e5b175dae77286baa09753f95428286ba6ce04e82e60cf78e52e5ddd5fcc5","observation_id":"42f7b517-b4fa-40d6-9934-6aabf37df891","resolution":{"observed_at":"2026-08-10T14:43:41.767831Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2301.09498","last_updated":"2023-03-16T01:51:00Z","snapshot_observed_at":"2026-08-14T22:36:16.164101Z","submitted_at":"2023-01-23T15:52:12Z","title":"Triplet Contrastive Representation Learning for Unsupervised Vehicle Re-identification","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2301.09498","snapshot_observed_at":"2026-08-10T14:43:41.819277Z","title":"Triplet contrastive learning for unsupervised vehicle re-identification,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2501.15063","last_updated":"2025-01-25T03:53:53Z","snapshot_observed_at":"2026-08-10T14:37:11.157983Z","submitted_at":"2025-01-25T03:53:53Z","title":"Cross-modal Context Fusion and Adaptive Graph Convolutional Network for Multimodal Conversational Emotion Recognition","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-10T14:43:41.819277Z"},"links":{"cited_paper":"/paper/2301.09498","citing_paper":"/paper/2501.15063"},"observation_digest":"sha256:f5fa7cbd1d282713b36dfcbe6c2024cb40995a1e378d9aeb414468c59eb76945","observation_id":"d0f365df-1d2f-49fd-8e1f-531eab34470d","resolution":{"observed_at":"2026-08-10T14:43:41.819277Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2407.12705","last_updated":"2024-08-06T13:06:26Z","snapshot_observed_at":"2026-08-12T23:20:12.207906Z","submitted_at":"2024-07-17T16:26:30Z","title":"IMAGDressing-v1: Customizable Virtual Dressing","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2407.12705","snapshot_observed_at":"2026-08-10T14:43:41.873432Z","title":"Imagdressing-v1: Customizable virtual dressing,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2501.15063","last_updated":"2025-01-25T03:53:53Z","snapshot_observed_at":"2026-08-10T14:37:11.157983Z","submitted_at":"2025-01-25T03:53:53Z","title":"Cross-modal Context Fusion and Adaptive Graph Convolutional Network for Multimodal Conversational Emotion Recognition","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-10T14:43:41.873432Z"},"links":{"cited_paper":"/paper/2407.12705","citing_paper":"/paper/2501.15063"},"observation_digest":"sha256:13ed6a1ede18b002dd06e9105943324f9c206030a0981e330e816c407eaddbef","observation_id":"c0a4e0e1-2d94-4569-85f5-07b3fb58f0f9","resolution":{"observed_at":"2026-08-10T14:43:41.873432Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T14:43:41.895820Z","title":"Imagpose: A unified conditional framework for pose-guided person generation,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2501.15063","last_updated":"2025-01-25T03:53:53Z","snapshot_observed_at":"2026-08-10T14:37:11.157983Z","submitted_at":"2025-01-25T03:53:53Z","title":"Cross-modal Context Fusion and Adaptive Graph Convolutional Network for Multimodal Conversational Emotion Recognition","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-10T14:43:41.895820Z"},"links":{"citing_paper":"/paper/2501.15063"},"observation_digest":"sha256:57c149095a5f9845cf79d5a772443ba23536c102454e14cfe043958382265e06","observation_id":"81a82d55-675c-4af6-b0b7-c3e303fb504c","resolution":{"observed_at":"2026-08-10T14:43:41.895820Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2407.02482","last_updated":"2024-07-03T18:17:01Z","snapshot_observed_at":"2026-08-12T23:30:11.505210Z","submitted_at":"2024-07-02T17:58:07Z","title":"Boosting Consistency in Story Visualization with Rich-Contextual Conditional Diffusion Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2407.02482","snapshot_observed_at":"2026-08-10T14:43:41.930124Z","title":"Boosting consistency in story visualization with rich-contextual condi- tional diffusion models,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2501.15063","last_updated":"2025-01-25T03:53:53Z","snapshot_observed_at":"2026-08-10T14:37:11.157983Z","submitted_at":"2025-01-25T03:53:53Z","title":"Cross-modal Context Fusion and Adaptive Graph Convolutional Network for Multimodal Conversational Emotion Recognition","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-10T14:43:41.930124Z"},"links":{"cited_paper":"/paper/2407.02482","citing_paper":"/paper/2501.15063"},"observation_digest":"sha256:51b175c78464fd603e196d3efdb2724bb9ace62834e01b77ddfe099099c6f9de","observation_id":"c52d4c8e-0baa-4009-af5c-9b6092f02491","resolution":{"observed_at":"2026-08-10T14:43:41.930124Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T14:43:43.196467Z","title":"Context-dependent sentiment analysis in user-generated videos","venue":null,"work_id":"152b9b59-1fbf-4cb0-b3c2-ee8f58aeeb69","year":2017},"citing_paper":{"arxiv_id":"2501.15063","last_updated":"2025-01-25T03:53:53Z","snapshot_observed_at":"2026-08-10T14:37:11.157983Z","submitted_at":"2025-01-25T03:53:53Z","title":"Cross-modal Context Fusion and Adaptive Graph Convolutional Network for Multimodal Conversational Emotion Recognition","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-10T14:43:41.967556Z"},"links":{"citing_paper":"/paper/2501.15063"},"observation_digest":"sha256:67c36c52087a9271fa8dd2beef285b365b20c0a89a3924285caeba7f60e51990","observation_id":"48a52583-0b0b-4a28-8da9-b704d55a958e","resolution":{"observed_at":"2026-08-10T14:43:43.200504Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T14:43:43.169295Z","title":"Conversational memory network for emotion recognition in dyadic dialogue videos","venue":null,"work_id":"b92b058e-1ddb-4867-a01b-fd953c86e3bc","year":2018},"citing_paper":{"arxiv_id":"2501.15063","last_updated":"2025-01-25T03:53:53Z","snapshot_observed_at":"2026-08-10T14:37:11.157983Z","submitted_at":"2025-01-25T03:53:53Z","title":"Cross-modal Context Fusion and Adaptive Graph Convolutional Network for Multimodal Conversational Emotion Recognition","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-10T14:43:41.979156Z"},"links":{"citing_paper":"/paper/2501.15063"},"observation_digest":"sha256:8b6a51996a697a48c6574e10dbdb0ba980af5526e553a8dbce5b7ded62a53643","observation_id":"1a2521ce-dcbc-49f2-aaec-4b74b015cf60","resolution":{"observed_at":"2026-08-10T14:43:43.176986Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T14:43:43.080636Z","title":"Dialoguernn: An attentive rnn for emotion detection in conversations,","venue":null,"work_id":"385ee553-64cf-4e79-a684-efbc49ad68b3","year":2019},"citing_paper":{"arxiv_id":"2501.15063","last_updated":"2025-01-25T03:53:53Z","snapshot_observed_at":"2026-08-10T14:37:11.157983Z","submitted_at":"2025-01-25T03:53:53Z","title":"Cross-modal Context Fusion and Adaptive Graph Convolutional Network for Multimodal Conversational Emotion Recognition","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-10T14:43:41.983315Z"},"links":{"citing_paper":"/paper/2501.15063"},"observation_digest":"sha256:de796071c9d18646036ef6866ff93278306bc16969c5653ad18d2fabbcc4f251","observation_id":"380519bb-9f61-456c-b5c7-56899c151e1c","resolution":{"observed_at":"2026-08-10T14:43:43.152801Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T14:43:42.963631Z","title":"Dia- loguegcn: A graph convolutional neural network for emotion recognition in conversation,","venue":null,"work_id":"6af2338f-cbba-4648-b293-a9a874b54290","year":2019},"citing_paper":{"arxiv_id":"2501.15063","last_updated":"2025-01-25T03:53:53Z","snapshot_observed_at":"2026-08-10T14:37:11.157983Z","submitted_at":"2025-01-25T03:53:53Z","title":"Cross-modal Context Fusion and Adaptive Graph Convolutional Network for Multimodal Conversational Emotion Recognition","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-10T14:43:41.989176Z"},"links":{"citing_paper":"/paper/2501.15063"},"observation_digest":"sha256:6e7e6cd8cfbbd6e15e5457c69574acbca4f2695b905f8e70d88020c96c633317","observation_id":"1d03fe31-e0ab-40ab-908b-a78e40d7e459","resolution":{"observed_at":"2026-08-10T14:43:42.996342Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T14:43:42.876132Z","title":"Mmgcn: Multimodal fusion via deep graph convolution network for emotion recognition in conversation,","venue":null,"work_id":"52225b55-508e-4a1a-80cc-8b884f4215a0","year":2021},"citing_paper":{"arxiv_id":"2501.15063","last_updated":"2025-01-25T03:53:53Z","snapshot_observed_at":"2026-08-10T14:37:11.157983Z","submitted_at":"2025-01-25T03:53:53Z","title":"Cross-modal Context Fusion and Adaptive Graph Convolutional Network for Multimodal Conversational Emotion Recognition","version":1},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-10T14:43:41.992511Z"},"links":{"citing_paper":"/paper/2501.15063"},"observation_digest":"sha256:b1952770ccc14bce0c3b075888e28717f0df056a09894b225dd504a219fe2611","observation_id":"02f9f152-e82d-4c28-b345-b28992bda52e","resolution":{"observed_at":"2026-08-10T14:43:42.923730Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T14:43:42.794583Z","title":"Git: Graph interactive transformer for vehicle re-identification,","venue":null,"work_id":"3d3e0b72-624e-4e9a-bc67-e192fc844587","year":2023},"citing_paper":{"arxiv_id":"2501.15063","last_updated":"2025-01-25T03:53:53Z","snapshot_observed_at":"2026-08-10T14:37:11.157983Z","submitted_at":"2025-01-25T03:53:53Z","title":"Cross-modal Context Fusion and Adaptive Graph Convolutional Network for Multimodal Conversational Emotion Recognition","version":1},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-10T14:43:41.997186Z"},"links":{"citing_paper":"/paper/2501.15063"},"observation_digest":"sha256:6f62f4aefca4c433693b18ecfe07a7fd35718a2d1f0c7ce120e949d3c9bd64fa","observation_id":"a1c0b045-aee5-4752-b48c-ccd0411ce67c","resolution":{"observed_at":"2026-08-10T14:43:42.801775Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T14:43:42.001119Z","title":"Pedestrian-specific bipartite-aware similarity learning for text-based person retrieval,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2501.15063","last_updated":"2025-01-25T03:53:53Z","snapshot_observed_at":"2026-08-10T14:37:11.157983Z","submitted_at":"2025-01-25T03:53:53Z","title":"Cross-modal Context Fusion and Adaptive Graph Convolutional Network for Multimodal Conversational Emotion Recognition","version":1},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-10T14:43:42.001119Z"},"links":{"citing_paper":"/paper/2501.15063"},"observation_digest":"sha256:5d3093490c73060508bd3293989821e1d423f22e9ccfde67b932e027681c2273","observation_id":"8a806df1-add5-43cd-8df6-578fec6b8e71","resolution":{"observed_at":"2026-08-10T14:43:42.001119Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T14:43:42.777587Z","title":"Semi-supervised classification with graph convolutional networks,","venue":null,"work_id":"3580a41b-f91c-4ba6-aff2-39c2e4aa7027","year":2016},"citing_paper":{"arxiv_id":"2501.15063","last_updated":"2025-01-25T03:53:53Z","snapshot_observed_at":"2026-08-10T14:37:11.157983Z","submitted_at":"2025-01-25T03:53:53Z","title":"Cross-modal Context Fusion and Adaptive Graph Convolutional Network for Multimodal Conversational Emotion Recognition","version":1},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-10T14:43:42.014650Z"},"links":{"citing_paper":"/paper/2501.15063"},"observation_digest":"sha256:2dfb1a080b3be3a2efc417a841178afbaed03ca6e13ae34005c144a878a9faf3","observation_id":"5103a0af-ecc2-498e-8cd4-71e9f1345a1b","resolution":{"observed_at":"2026-08-10T14:43:42.781459Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T14:43:42.766856Z","title":"Inductive representation learn- ing on large graphs,","venue":null,"work_id":"6bf4706d-d83c-4ac3-8245-6371f22a5428","year":2017},"citing_paper":{"arxiv_id":"2501.15063","last_updated":"2025-01-25T03:53:53Z","snapshot_observed_at":"2026-08-10T14:37:11.157983Z","submitted_at":"2025-01-25T03:53:53Z","title":"Cross-modal Context Fusion and Adaptive Graph Convolutional Network for Multimodal Conversational Emotion Recognition","version":1},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-10T14:43:42.028222Z"},"links":{"citing_paper":"/paper/2501.15063"},"observation_digest":"sha256:481c0377c55a2bbe0fb4eefd22897097d48f5170f4986c13df40b40b50919be9","observation_id":"9f7b8039-5bb8-4ba6-a5ea-93549239f940","resolution":{"observed_at":"2026-08-10T14:43:42.771000Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T14:43:42.756447Z","title":"Liu and J","venue":null,"work_id":"45f70843-43d9-4951-9bda-689dddce5a21","year":2020},"citing_paper":{"arxiv_id":"2501.15063","last_updated":"2025-01-25T03:53:53Z","snapshot_observed_at":"2026-08-10T14:37:11.157983Z","submitted_at":"2025-01-25T03:53:53Z","title":"Cross-modal Context Fusion and Adaptive Graph Convolutional Network for Multimodal Conversational Emotion Recognition","version":1},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-08-10T14:43:42.039088Z"},"links":{"citing_paper":"/paper/2501.15063"},"observation_digest":"sha256:a9339c76219041221cb51daae511a56d5f534b62359b5486ea2bf4451b6ebc34","observation_id":"d140e467-7f26-433e-ab5f-bcdbd38f0af0","resolution":{"observed_at":"2026-08-10T14:43:42.760009Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T14:43:42.735822Z","title":null,"venue":null,"work_id":"9820e401-9b46-458b-8507-0ec32b5d1455","year":2021},"citing_paper":{"arxiv_id":"2501.15063","last_updated":"2025-01-25T03:53:53Z","snapshot_observed_at":"2026-08-10T14:37:11.157983Z","submitted_at":"2025-01-25T03:53:53Z","title":"Cross-modal Context Fusion and Adaptive Graph Convolutional Network for Multimodal Conversational Emotion Recognition","version":1},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-08-10T14:43:42.063634Z"},"links":{"citing_paper":"/paper/2501.15063"},"observation_digest":"sha256:3db32427480b4458d3cbcbe832765c86a4f1b09244ddd09234b0e57d414aeda3","observation_id":"057b279b-d7cf-4bd8-bf7e-ec0448217d1a","resolution":{"observed_at":"2026-08-10T14:43:42.744771Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T14:43:42.718098Z","title":"Bert: Pre-training of deep bidirectional transformers for language understanding,","venue":null,"work_id":"a9e6b6c5-a963-4921-a970-cb7ce58c1277","year":2019},"citing_paper":{"arxiv_id":"2501.15063","last_updated":"2025-01-25T03:53:53Z","snapshot_observed_at":"2026-08-10T14:37:11.157983Z","submitted_at":"2025-01-25T03:53:53Z","title":"Cross-modal Context Fusion and Adaptive Graph Convolutional Network for Multimodal Conversational Emotion Recognition","version":1},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-08-10T14:43:42.097107Z"},"links":{"citing_paper":"/paper/2501.15063"},"observation_digest":"sha256:36e8c5fb9abf6e3ff474207144059dc466a4b86ef008115c22bd722f4f91a770","observation_id":"9c0762fa-8f1d-44da-a5cf-a29fa1b0dbaa","resolution":{"observed_at":"2026-08-10T14:43:42.723644Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T14:43:42.694050Z","title":"Opensmile: the munich versatile and fast open-source audio feature extractor,","venue":null,"work_id":"2d28e6be-ff90-4b32-98a4-985f13a9e3be","year":2010},"citing_paper":{"arxiv_id":"2501.15063","last_updated":"2025-01-25T03:53:53Z","snapshot_observed_at":"2026-08-10T14:37:11.157983Z","submitted_at":"2025-01-25T03:53:53Z","title":"Cross-modal Context Fusion and Adaptive Graph Convolutional Network for Multimodal Conversational Emotion Recognition","version":1},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-08-10T14:43:42.100612Z"},"links":{"citing_paper":"/paper/2501.15063"},"observation_digest":"sha256:a0ce8b34304413521f06c18db64cc83f0c96f780637f468072fd6f26923f8a2c","observation_id":"d8e6dfce-59fc-4411-acdd-d26c639a3ec8","resolution":{"observed_at":"2026-08-10T14:43:42.705886Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T14:43:42.584595Z","title":"Densely connected convolutional networks,","venue":null,"work_id":"47d9a0bc-310b-4859-a31b-9568c3a55447","year":2017},"citing_paper":{"arxiv_id":"2501.15063","last_updated":"2025-01-25T03:53:53Z","snapshot_observed_at":"2026-08-10T14:37:11.157983Z","submitted_at":"2025-01-25T03:53:53Z","title":"Cross-modal Context Fusion and Adaptive Graph Convolutional Network for Multimodal Conversational Emotion Recognition","version":1},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-08-10T14:43:42.105581Z"},"links":{"citing_paper":"/paper/2501.15063"},"observation_digest":"sha256:82b68bdd79bb07ae0314f0ee817eaef756bda7aec3b01a35ac9f651ac184573f","observation_id":"5c23eaf0-84f4-4b8f-ab4a-ecbcd01bf464","resolution":{"observed_at":"2026-08-10T14:43:42.656901Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T14:43:42.505202Z","title":"Deep residual learning for image recognition,","venue":null,"work_id":"9d1a4672-b91a-4bd5-9511-7275d8588d01","year":2016},"citing_paper":{"arxiv_id":"2501.15063","last_updated":"2025-01-25T03:53:53Z","snapshot_observed_at":"2026-08-10T14:37:11.157983Z","submitted_at":"2025-01-25T03:53:53Z","title":"Cross-modal Context Fusion and Adaptive Graph Convolutional Network for Multimodal Conversational Emotion Recognition","version":1},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-08-10T14:43:42.114214Z"},"links":{"citing_paper":"/paper/2501.15063"},"observation_digest":"sha256:d17fc0485fa99bd74e696c4909b629cac45d102c3a895ff108ccadf7ec34a337","observation_id":"e19d5933-9d27-48ca-99d3-e354c4675594","resolution":{"observed_at":"2026-08-10T14:43:42.552993Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T14:43:42.443830Z","title":"Hierarchical question-image co- attention for visual question answering,","venue":null,"work_id":"9276dc38-9906-461f-836b-ea9bc4415c51","year":2016},"citing_paper":{"arxiv_id":"2501.15063","last_updated":"2025-01-25T03:53:53Z","snapshot_observed_at":"2026-08-10T14:37:11.157983Z","submitted_at":"2025-01-25T03:53:53Z","title":"Cross-modal Context Fusion and Adaptive Graph Convolutional Network for Multimodal Conversational Emotion Recognition","version":1},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-08-10T14:43:42.117755Z"},"links":{"citing_paper":"/paper/2501.15063"},"observation_digest":"sha256:2391c30c62379ba6420d5b0d4254e00002d6df665553f76bd3f8ddba7dc2a2af","observation_id":"2449b76f-a709-41c1-9b91-5458415524d4","resolution":{"observed_at":"2026-08-10T14:43:42.456047Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T14:43:42.362382Z","title":"Empirical evaluation of gated recurrent neural networks on sequence modeling,","venue":null,"work_id":"c0f505cd-ec62-4f73-9f77-c4791ee95254","year":2014},"citing_paper":{"arxiv_id":"2501.15063","last_updated":"2025-01-25T03:53:53Z","snapshot_observed_at":"2026-08-10T14:37:11.157983Z","submitted_at":"2025-01-25T03:53:53Z","title":"Cross-modal Context Fusion and Adaptive Graph Convolutional Network for Multimodal Conversational Emotion Recognition","version":1},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-08-10T14:43:42.124560Z"},"links":{"citing_paper":"/paper/2501.15063"},"observation_digest":"sha256:50224d6052b5728ed26c6f3f944fa26fc411208efc3932d953ca9ebbdb9ad656","observation_id":"cc2e2a9d-67d4-47bc-b588-6d225fb1c39f","resolution":{"observed_at":"2026-08-10T14:43:42.391944Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T14:43:42.304542Z","title":"Iemocap: interactive emotional dyadic motion capture database,","venue":null,"work_id":"ee167197-79dd-477b-8cb7-22fc588d888f","year":2008},"citing_paper":{"arxiv_id":"2501.15063","last_updated":"2025-01-25T03:53:53Z","snapshot_observed_at":"2026-08-10T14:37:11.157983Z","submitted_at":"2025-01-25T03:53:53Z","title":"Cross-modal Context Fusion and Adaptive Graph Convolutional Network for Multimodal Conversational Emotion Recognition","version":1},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-08-10T14:43:42.134876Z"},"links":{"citing_paper":"/paper/2501.15063"},"observation_digest":"sha256:37cbdb81a1292360804c68269188966ad87c85b63cf3559d924c1d8df4fa45f1","observation_id":"97a5c96b-8aa0-4bea-b647-bf30a512f480","resolution":{"observed_at":"2026-08-10T14:43:42.330377Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T14:43:42.249611Z","title":"Icon: Interactive conversational memory network for multimodal emo- tion detection,","venue":null,"work_id":"84fec279-f902-4ade-b30a-f2cff933fa9d","year":2018},"citing_paper":{"arxiv_id":"2501.15063","last_updated":"2025-01-25T03:53:53Z","snapshot_observed_at":"2026-08-10T14:37:11.157983Z","submitted_at":"2025-01-25T03:53:53Z","title":"Cross-modal Context Fusion and Adaptive Graph Convolutional Network for Multimodal Conversational Emotion Recognition","version":1},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-08-10T14:43:42.145821Z"},"links":{"citing_paper":"/paper/2501.15063"},"observation_digest":"sha256:9aa2a9c3bad70e21237498c9eb12733796ee7f11c38b05cd5eef29af45fbbb06","observation_id":"c500f671-fa67-4565-80ba-21502555b203","resolution":{"observed_at":"2026-08-10T14:43:42.274845Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1810.02508","last_updated":"2019-06-04T12:33:49Z","snapshot_observed_at":"2026-08-14T18:19:10.821318Z","submitted_at":"2018-10-05T03:50:24Z","title":"MELD: A Multimodal Multi-Party Dataset for Emotion Recognition in Conversations","version":6},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1810.02508","snapshot_observed_at":"2026-08-10T14:43:42.168958Z","title":"Meld: A multimodal multi-party dataset for emotion recognition in conversations,","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2501.15063","last_updated":"2025-01-25T03:53:53Z","snapshot_observed_at":"2026-08-10T14:37:11.157983Z","submitted_at":"2025-01-25T03:53:53Z","title":"Cross-modal Context Fusion and Adaptive Graph Convolutional Network for Multimodal Conversational Emotion Recognition","version":1},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-08-10T14:43:42.168958Z"},"links":{"cited_paper":"/paper/1810.02508","citing_paper":"/paper/2501.15063"},"observation_digest":"sha256:e6bd7a237e2360388da5e9155e2bd0f34bece17807add04a96286a48463c0825","observation_id":"e6f5bcd4-f365-4d4a-a6fd-77819a7e2a7d","resolution":{"observed_at":"2026-08-10T14:43:42.168958Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"paper":{"arxiv_id":"2501.15063","last_updated":"2025-01-25T03:53:53Z","latest_version":1,"primary_category":"cs.CL","snapshot_observed_at":"2026-08-10T14:37:11.157983Z","submitted_at":"2025-01-25T03:53:53Z","title":"Cross-modal Context Fusion and Adaptive Graph Convolutional Network for Multimodal Conversational Emotion Recognition"},"reference_resolution":{"displayed":35,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":8,"verified_exact":0,"verified_fuzzy":27},"total_outbound_references":35},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"thesis":"As of 15 August 2026, this Paper Citation Record lists 35 of 35 outbound references and 1 inbound Pith citation observation for arXiv:2501.15063."}