{"as_of":"2026-08-19T02:14:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:f47751844568dd6517baa6663ca8680072d95c7c6c268a4c9db06c231903ed8d","coverage":[{"denominator":52,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":52,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-07T14:25:42.697041Z","state":"measured"},{"denominator":52,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":52,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-18T06:34:40.430872+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2505.19010/citation-record","integrity":"/paper/2505.19010/integrity","json":"/paper/2505.19010/citation-record.json","paper":"/paper/2505.19010"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:25:37.872689Z","title":"Multimodal machine learning: A survey and taxonomy,","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2505.19010","last_updated":"2025-07-30T10:40:17Z","snapshot_observed_at":"2026-08-18T01:30:27.683881Z","submitted_at":"2025-05-25T07:26:00Z","title":"Co-AttenDWG: Co-Attentive Dimension-Wise Gating and Expert Fusion for Multi-Modal Offensive Content Detection","version":2},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-07T14:25:37.872689Z"},"links":{"citing_paper":"/paper/2505.19010"},"observation_digest":"sha256:a42a33d917abbab3915df2e24e1007deb21af3088cdcab6456aa3dcf2ed0557f","observation_id":"7426dc14-bf73-4f5e-b7ac-79213c5db4ea","resolution":{"observed_at":"2026-08-07T14:25:37.872689Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:25:44.167030Z","title":"Multimodal deep learning","venue":null,"work_id":"bfc79648-7beb-4b2f-851e-3af06ce26e6a","year":2011},"citing_paper":{"arxiv_id":"2505.19010","last_updated":"2025-07-30T10:40:17Z","snapshot_observed_at":"2026-08-18T01:30:27.683881Z","submitted_at":"2025-05-25T07:26:00Z","title":"Co-AttenDWG: Co-Attentive Dimension-Wise Gating and Expert Fusion for Multi-Modal Offensive Content Detection","version":2},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-07T14:25:37.942594Z"},"links":{"citing_paper":"/paper/2505.19010"},"observation_digest":"sha256:fe451a63e5ac99d163f34ee4a2823ac837d1d724f815bf3786a5d1be81bba109","observation_id":"f24c4196-a0a5-424c-ac26-7860ebe3edc7","resolution":{"observed_at":"2026-08-07T14:25:44.171133Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:25:44.155757Z","title":"Emogif: A multimodal approach to detect emotional support in animated gifs,","venue":null,"work_id":"31cbe63e-d049-4267-a7ae-039952709ac2","year":2025},"citing_paper":{"arxiv_id":"2505.19010","last_updated":"2025-07-30T10:40:17Z","snapshot_observed_at":"2026-08-18T01:30:27.683881Z","submitted_at":"2025-05-25T07:26:00Z","title":"Co-AttenDWG: Co-Attentive Dimension-Wise Gating and Expert Fusion for Multi-Modal Offensive Content Detection","version":2},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-07T14:25:38.027417Z"},"links":{"citing_paper":"/paper/2505.19010"},"observation_digest":"sha256:c35b4dad0045558b65da6adb992a9382b2cb6ba0d2d48d7e6dcc3c27c537fa92","observation_id":"2b420d81-273b-4fdd-ac56-9acab1fcb84b","resolution":{"observed_at":"2026-08-07T14:25:44.160580Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:25:44.146314Z","title":"Show, attend and tell: Neural image caption generation with visual attention,","venue":null,"work_id":"f658dbbd-fd8c-44fc-848d-c11b80cc5f4d","year":2015},"citing_paper":{"arxiv_id":"2505.19010","last_updated":"2025-07-30T10:40:17Z","snapshot_observed_at":"2026-08-18T01:30:27.683881Z","submitted_at":"2025-05-25T07:26:00Z","title":"Co-AttenDWG: Co-Attentive Dimension-Wise Gating and Expert Fusion for Multi-Modal Offensive Content Detection","version":2},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-07T14:25:38.111524Z"},"links":{"citing_paper":"/paper/2505.19010"},"observation_digest":"sha256:98fea16ef52c64bcdceb97539e0f9cd649f94284978c401032456a8d1b175dc3","observation_id":"902f643d-cccd-451a-8b66-850a5ffae337","resolution":{"observed_at":"2026-08-07T14:25:44.149666Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:25:44.135224Z","title":"Multiseao-mix: A multimodal multitask framework for sentiment, emotion, support, and offensive analysis in code-mixed setting,","venue":null,"work_id":"57631baf-a5f8-44be-a14f-f6768524807b","year":2024},"citing_paper":{"arxiv_id":"2505.19010","last_updated":"2025-07-30T10:40:17Z","snapshot_observed_at":"2026-08-18T01:30:27.683881Z","submitted_at":"2025-05-25T07:26:00Z","title":"Co-AttenDWG: Co-Attentive Dimension-Wise Gating and Expert Fusion for Multi-Modal Offensive Content Detection","version":2},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-07T14:25:38.187381Z"},"links":{"citing_paper":"/paper/2505.19010"},"observation_digest":"sha256:1ca500fefb0adf8d6cd61f11b3dcb493011bdf1ce2d4a833099db6adc21a7a5e","observation_id":"c4a83c42-d133-4e0c-ba31-b529b1748ae2","resolution":{"observed_at":"2026-08-07T14:25:44.139487Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:25:38.279116Z","title":"Bert: Pre-training of deep bidirectional transformers for language understanding,","venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2505.19010","last_updated":"2025-07-30T10:40:17Z","snapshot_observed_at":"2026-08-18T01:30:27.683881Z","submitted_at":"2025-05-25T07:26:00Z","title":"Co-AttenDWG: Co-Attentive Dimension-Wise Gating and Expert Fusion for Multi-Modal Offensive Content Detection","version":2},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-07T14:25:38.279116Z"},"links":{"citing_paper":"/paper/2505.19010"},"observation_digest":"sha256:db1b660f9bded2cdeab51021676a33cc9252f8cb5bfe5b25809a1882708a16b2","observation_id":"5d41d327-900d-4882-b56f-2318326761f3","resolution":{"observed_at":"2026-08-07T14:25:38.279116Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:25:44.119260Z","title":"Multilingual denoising pre-training for neural machine translation,","venue":null,"work_id":"236dd58d-02f1-403d-a445-891a24707390","year":2020},"citing_paper":{"arxiv_id":"2505.19010","last_updated":"2025-07-30T10:40:17Z","snapshot_observed_at":"2026-08-18T01:30:27.683881Z","submitted_at":"2025-05-25T07:26:00Z","title":"Co-AttenDWG: Co-Attentive Dimension-Wise Gating and Expert Fusion for Multi-Modal Offensive Content Detection","version":2},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-07T14:25:38.370581Z"},"links":{"citing_paper":"/paper/2505.19010"},"observation_digest":"sha256:cc9afd7cb32d15ce7fb0a6c9129156b2028b286b4a95ad69fc1197f725ee878c","observation_id":"16e166f3-61b0-48d1-938a-a71918818feb","resolution":{"observed_at":"2026-08-07T14:25:44.123745Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:25:44.108969Z","title":"Unsupervised cross-lingual repre- sentation learning,","venue":null,"work_id":"0a2be851-1659-48a2-adb5-50958ed8d584","year":2019},"citing_paper":{"arxiv_id":"2505.19010","last_updated":"2025-07-30T10:40:17Z","snapshot_observed_at":"2026-08-18T01:30:27.683881Z","submitted_at":"2025-05-25T07:26:00Z","title":"Co-AttenDWG: Co-Attentive Dimension-Wise Gating and Expert Fusion for Multi-Modal Offensive Content Detection","version":2},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-07T14:25:38.470642Z"},"links":{"citing_paper":"/paper/2505.19010"},"observation_digest":"sha256:5d81d1b6a3675fb57ce271b9b2243a1191cd552107711ab90152c485f05c105f","observation_id":"658d7049-9d45-493b-b371-e5ebc9a0f820","resolution":{"observed_at":"2026-08-07T14:25:44.112907Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:25:44.098784Z","title":"Imagenet classification with deep convolutional neural networks,","venue":null,"work_id":"eccd7b04-d8ce-4efa-9a7d-3dacff4dd034","year":2012},"citing_paper":{"arxiv_id":"2505.19010","last_updated":"2025-07-30T10:40:17Z","snapshot_observed_at":"2026-08-18T01:30:27.683881Z","submitted_at":"2025-05-25T07:26:00Z","title":"Co-AttenDWG: Co-Attentive Dimension-Wise Gating and Expert Fusion for Multi-Modal Offensive Content Detection","version":2},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-07T14:25:38.552713Z"},"links":{"citing_paper":"/paper/2505.19010"},"observation_digest":"sha256:cf82121ae1918de444c62c4d8d64ac1d1328c8d31f7f71ca8b3941b5aee5c002","observation_id":"7a3f7d40-4490-4c78-8346-0d8f285a8c6c","resolution":{"observed_at":"2026-08-07T14:25:44.102214Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:25:38.624541Z","title":"Deep residual learning for image recognition,","venue":null,"work_id":null,"year":2016},"citing_paper":{"arxiv_id":"2505.19010","last_updated":"2025-07-30T10:40:17Z","snapshot_observed_at":"2026-08-18T01:30:27.683881Z","submitted_at":"2025-05-25T07:26:00Z","title":"Co-AttenDWG: Co-Attentive Dimension-Wise Gating and Expert Fusion for Multi-Modal Offensive Content Detection","version":2},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-07T14:25:38.624541Z"},"links":{"citing_paper":"/paper/2505.19010"},"observation_digest":"sha256:65ef6a2b0a9bad897d16dfb04ce6b1ca7b7a69d421fd7f8b7ea5eccf9945ebb2","observation_id":"6d7b13d8-ce9c-4d2d-9382-3a8f5f05fb59","resolution":{"observed_at":"2026-08-07T14:25:38.624541Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2010.11929","last_updated":"2021-06-03T13:08:56Z","snapshot_observed_at":"2026-08-16T09:25:53.087782Z","submitted_at":"2020-10-22T17:55:59Z","title":"An Image is Worth 16x16 Words: Transformers for Image Recognition at Scale","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2010.11929","snapshot_observed_at":"2026-08-07T14:25:38.661836Z","title":"An image is worth 16x16 words: Transformers for image recognition at scale,","venue":null,"work_id":null,"year":2010},"citing_paper":{"arxiv_id":"2505.19010","last_updated":"2025-07-30T10:40:17Z","snapshot_observed_at":"2026-08-18T01:30:27.683881Z","submitted_at":"2025-05-25T07:26:00Z","title":"Co-AttenDWG: Co-Attentive Dimension-Wise Gating and Expert Fusion for Multi-Modal Offensive Content Detection","version":2},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-07T14:25:38.661836Z"},"links":{"cited_paper":"/paper/2010.11929","citing_paper":"/paper/2505.19010"},"observation_digest":"sha256:0563ebef55bbb18ac8de6f81f664c31de3aa490fc15b2199b964a25bc0e35807","observation_id":"f1d1876b-3b70-424b-8a05-1bea3487143f","resolution":{"observed_at":"2026-08-07T14:25:38.661836Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:25:38.750840Z","title":"Vilbert: Pretraining task-agnostic visiolinguistic representations for vision-and-language tasks,","venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2505.19010","last_updated":"2025-07-30T10:40:17Z","snapshot_observed_at":"2026-08-18T01:30:27.683881Z","submitted_at":"2025-05-25T07:26:00Z","title":"Co-AttenDWG: Co-Attentive Dimension-Wise Gating and Expert Fusion for Multi-Modal Offensive Content Detection","version":2},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-07T14:25:38.750840Z"},"links":{"citing_paper":"/paper/2505.19010"},"observation_digest":"sha256:155951474388b4ee466d65d6e5035d29d94921bcc1223abf65f8903762249610","observation_id":"dd71c400-66c0-4fef-b5a6-a41928fc1343","resolution":{"observed_at":"2026-08-07T14:25:38.750840Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1908.07490","last_updated":"2019-12-03T19:30:19Z","snapshot_observed_at":"2026-08-17T10:15:40.814612Z","submitted_at":"2019-08-20T17:05:18Z","title":"LXMERT: Learning Cross-Modality Encoder Representations from Transformers","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1908.07490","snapshot_observed_at":"2026-08-07T14:25:38.844816Z","title":"Lxmert: Learning cross-modality encoder representations from transformers,","venue":null,"work_id":null,"year":1908},"citing_paper":{"arxiv_id":"2505.19010","last_updated":"2025-07-30T10:40:17Z","snapshot_observed_at":"2026-08-18T01:30:27.683881Z","submitted_at":"2025-05-25T07:26:00Z","title":"Co-AttenDWG: Co-Attentive Dimension-Wise Gating and Expert Fusion for Multi-Modal Offensive Content Detection","version":2},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-07T14:25:38.844816Z"},"links":{"cited_paper":"/paper/1908.07490","citing_paper":"/paper/2505.19010"},"observation_digest":"sha256:54b1cc4142dfc090f73c08babe5c963fb9dc965f6bebfaa41968b88c57cc934c","observation_id":"ad827976-8831-489f-b4b5-16461dbe007a","resolution":{"observed_at":"2026-08-07T14:25:38.844816Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1908.03557","last_updated":"2019-08-09T17:57:13Z","snapshot_observed_at":"2026-08-07T01:39:40.489262Z","submitted_at":"2019-08-09T17:57:13Z","title":"VisualBERT: A Simple and Performant Baseline for Vision and Language","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1908.03557","snapshot_observed_at":"2026-08-07T14:25:38.941875Z","title":"Visualbert: A simple and performant baseline for vision and language,","venue":null,"work_id":null,"year":1908},"citing_paper":{"arxiv_id":"2505.19010","last_updated":"2025-07-30T10:40:17Z","snapshot_observed_at":"2026-08-18T01:30:27.683881Z","submitted_at":"2025-05-25T07:26:00Z","title":"Co-AttenDWG: Co-Attentive Dimension-Wise Gating and Expert Fusion for Multi-Modal Offensive Content Detection","version":2},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-07T14:25:38.941875Z"},"links":{"cited_paper":"/paper/1908.03557","citing_paper":"/paper/2505.19010"},"observation_digest":"sha256:568292c80e512977857da378f1b8c554efa0e7b55bba3e04d227b0e7a0fb171e","observation_id":"c6891c61-a7a7-47f5-8ff2-e98e354b9148","resolution":{"observed_at":"2026-08-07T14:25:38.941875Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:25:44.077044Z","title":"Uniter: Learning universal image-text representations,","venue":null,"work_id":"0df247c7-c019-4ab3-bc3d-41f068a28bbe","year":2019},"citing_paper":{"arxiv_id":"2505.19010","last_updated":"2025-07-30T10:40:17Z","snapshot_observed_at":"2026-08-18T01:30:27.683881Z","submitted_at":"2025-05-25T07:26:00Z","title":"Co-AttenDWG: Co-Attentive Dimension-Wise Gating and Expert Fusion for Multi-Modal Offensive Content Detection","version":2},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-07T14:25:39.053643Z"},"links":{"citing_paper":"/paper/2505.19010"},"observation_digest":"sha256:7b0a399fffca3dd9c224e882ae82e4e99dd2ce5a2e3c6f26fa5e19184647d149","observation_id":"44702e3d-d257-4b8d-bf43-a3528f56e3dd","resolution":{"observed_at":"2026-08-07T14:25:44.080800Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:25:44.065633Z","title":"Dimension-wise gated cross-attention for multimodal sentiment analysis,","venue":null,"work_id":"c2c9642c-3ae2-4dfc-b219-56cc616a8ece","year":2025},"citing_paper":{"arxiv_id":"2505.19010","last_updated":"2025-07-30T10:40:17Z","snapshot_observed_at":"2026-08-18T01:30:27.683881Z","submitted_at":"2025-05-25T07:26:00Z","title":"Co-AttenDWG: Co-Attentive Dimension-Wise Gating and Expert Fusion for Multi-Modal Offensive Content Detection","version":2},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-07T14:25:39.162101Z"},"links":{"citing_paper":"/paper/2505.19010"},"observation_digest":"sha256:bce815122829c05fa08a182726810d1255ed56642f1ab97b49d6079b3973110f","observation_id":"6ea5b5c5-9a58-4e88-98ab-87d2a4d5813e","resolution":{"observed_at":"2026-08-07T14:25:44.069844Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:25:39.289878Z","title":"Multimodal transformer for unaligned multimodal language sequences,","venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2505.19010","last_updated":"2025-07-30T10:40:17Z","snapshot_observed_at":"2026-08-18T01:30:27.683881Z","submitted_at":"2025-05-25T07:26:00Z","title":"Co-AttenDWG: Co-Attentive Dimension-Wise Gating and Expert Fusion for Multi-Modal Offensive Content Detection","version":2},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-07T14:25:39.289878Z"},"links":{"citing_paper":"/paper/2505.19010"},"observation_digest":"sha256:ae14614807b3b7e13d729086b355dee3cdf2594fcda1c2a9d5f764f7c079efe4","observation_id":"3ee61b13-c91d-4c1f-844d-3ed3e0a293fe","resolution":{"observed_at":"2026-08-07T14:25:39.289878Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:25:44.048688Z","title":"Relation-aware graph attention network for visual question answering,","venue":null,"work_id":"8c45a258-4fec-4f27-aa1a-cec8a4b4746e","year":2019},"citing_paper":{"arxiv_id":"2505.19010","last_updated":"2025-07-30T10:40:17Z","snapshot_observed_at":"2026-08-18T01:30:27.683881Z","submitted_at":"2025-05-25T07:26:00Z","title":"Co-AttenDWG: Co-Attentive Dimension-Wise Gating and Expert Fusion for Multi-Modal Offensive Content Detection","version":2},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-07T14:25:39.406775Z"},"links":{"citing_paper":"/paper/2505.19010"},"observation_digest":"sha256:e66d99a772fa65fad45c29059b0bc21370f06e711d466a720ea1666ec1a6252a","observation_id":"4a72b04b-181d-4c65-9fce-f816c012b36e","resolution":{"observed_at":"2026-08-07T14:25:44.052668Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:25:44.037463Z","title":"Multi-modal discussion transformer: Integrating text, images and graph transformers to detect hate speech on social media,","venue":null,"work_id":"f11fe623-fae2-444f-b9dd-49d39deeacdf","year":2024},"citing_paper":{"arxiv_id":"2505.19010","last_updated":"2025-07-30T10:40:17Z","snapshot_observed_at":"2026-08-18T01:30:27.683881Z","submitted_at":"2025-05-25T07:26:00Z","title":"Co-AttenDWG: Co-Attentive Dimension-Wise Gating and Expert Fusion for Multi-Modal Offensive Content Detection","version":2},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-07T14:25:39.523915Z"},"links":{"citing_paper":"/paper/2505.19010"},"observation_digest":"sha256:26f7ddc7eb902720c16f344849021bf7c0c3bffdeb271a90ecfe9c0be9869bd5","observation_id":"5fed8fd8-0564-41d0-aaea-03421edce743","resolution":{"observed_at":"2026-08-07T14:25:44.042456Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:25:44.026897Z","title":"Multimodal sentiment analysis in realistic environments based on cross-modal hierarchical fusion network,","venue":null,"work_id":"46b87fba-90fa-4189-b857-8b1f1bdff817","year":2023},"citing_paper":{"arxiv_id":"2505.19010","last_updated":"2025-07-30T10:40:17Z","snapshot_observed_at":"2026-08-18T01:30:27.683881Z","submitted_at":"2025-05-25T07:26:00Z","title":"Co-AttenDWG: Co-Attentive Dimension-Wise Gating and Expert Fusion for Multi-Modal Offensive Content Detection","version":2},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-07T14:25:39.599546Z"},"links":{"citing_paper":"/paper/2505.19010"},"observation_digest":"sha256:4a204ecd77483b3a80c6f9ee0559a97aeb214d85af65f68a0eb90598959a41af","observation_id":"d93366e1-d6b7-4950-899b-982d557f0de2","resolution":{"observed_at":"2026-08-07T14:25:44.030708Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1909.02950","last_updated":"2020-11-12T03:08:28Z","snapshot_observed_at":"2026-08-18T16:52:30.946645Z","submitted_at":"2019-09-06T14:59:18Z","title":"Supervised Multimodal Bitransformers for Classifying Images and Text","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1909.02950","snapshot_observed_at":"2026-08-07T14:25:39.720399Z","title":"Super- vised multimodal bitransformers for classifying images and text,","venue":null,"work_id":null,"year":1909},"citing_paper":{"arxiv_id":"2505.19010","last_updated":"2025-07-30T10:40:17Z","snapshot_observed_at":"2026-08-18T01:30:27.683881Z","submitted_at":"2025-05-25T07:26:00Z","title":"Co-AttenDWG: Co-Attentive Dimension-Wise Gating and Expert Fusion for Multi-Modal Offensive Content Detection","version":2},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-07T14:25:39.720399Z"},"links":{"cited_paper":"/paper/1909.02950","citing_paper":"/paper/2505.19010"},"observation_digest":"sha256:d73c50ea7708fae2340ae32ea35a80953f6793e0d7753cd04aaf924f55436eac","observation_id":"4c4ec39b-7d84-4557-a1c6-48705d2ba659","resolution":{"observed_at":"2026-08-07T14:25:39.720399Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2202.06218","last_updated":"2022-02-13T05:39:47Z","snapshot_observed_at":"2026-08-16T17:21:43.306702Z","submitted_at":"2022-02-13T05:39:47Z","title":"Emotion Based Hate Speech Detection using Multimodal Learning","version":1},"cited_work":{"arxiv_id":"2202.06218","doi":null,"metadata_source":"pith","pith_arxiv_id":"2202.06218","snapshot_observed_at":"2026-08-07T14:25:42.876482Z","title":"Emotion Based Hate Speech Detection using Multimodal Learning","venue":"cs.LG","work_id":"4bc5af59-3e74-403b-ba44-c606bcc2cd22","year":2022},"citing_paper":{"arxiv_id":"2505.19010","last_updated":"2025-07-30T10:40:17Z","snapshot_observed_at":"2026-08-18T01:30:27.683881Z","submitted_at":"2025-05-25T07:26:00Z","title":"Co-AttenDWG: Co-Attentive Dimension-Wise Gating and Expert Fusion for Multi-Modal Offensive Content Detection","version":2},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-07T14:25:39.782460Z"},"links":{"cited_paper":"/paper/2202.06218","citing_paper":"/paper/2505.19010"},"observation_digest":"sha256:86ef0a2e09a2c505954fdb12e1ada7523beaa8df8a7fe80e4d7827b73572ece7","observation_id":"0c8edc1f-0588-410a-ba91-3e1aba14e250","resolution":{"observed_at":"2026-08-07T14:25:42.963784Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2110.01963","last_updated":"2021-10-05T11:47:27Z","snapshot_observed_at":"2026-08-17T20:03:41.214987Z","submitted_at":"2021-10-05T11:47:27Z","title":"Multimodal datasets: misogyny, pornography, and malignant stereotypes","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2110.01963","snapshot_observed_at":"2026-08-07T14:25:39.827592Z","title":"Multimodal datasets: misogyny, pornography, and malignant stereotypes,","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2505.19010","last_updated":"2025-07-30T10:40:17Z","snapshot_observed_at":"2026-08-18T01:30:27.683881Z","submitted_at":"2025-05-25T07:26:00Z","title":"Co-AttenDWG: Co-Attentive Dimension-Wise Gating and Expert Fusion for Multi-Modal Offensive Content Detection","version":2},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-07T14:25:39.827592Z"},"links":{"cited_paper":"/paper/2110.01963","citing_paper":"/paper/2505.19010"},"observation_digest":"sha256:89d14c1dc9c2ca043ce609180f7b15e226d64455f6ece47ba3ec714d452f20bf","observation_id":"a5aea849-5b60-4c91-9ba3-ba9f74292407","resolution":{"observed_at":"2026-08-07T14:25:39.827592Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:25:44.016685Z","title":"Mul- timodal meme dataset (multioff) for identifying offensive content in image and text,","venue":null,"work_id":"01fdd80a-c482-4f7e-91a4-143828e3b51a","year":2020},"citing_paper":{"arxiv_id":"2505.19010","last_updated":"2025-07-30T10:40:17Z","snapshot_observed_at":"2026-08-18T01:30:27.683881Z","submitted_at":"2025-05-25T07:26:00Z","title":"Co-AttenDWG: Co-Attentive Dimension-Wise Gating and Expert Fusion for Multi-Modal Offensive Content Detection","version":2},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-07T14:25:39.949349Z"},"links":{"citing_paper":"/paper/2505.19010"},"observation_digest":"sha256:7f078d65ab3f14856228a70743b66c81d002dfd1beb1cbf7984395d325a53072","observation_id":"a63db17a-0cde-4306-8178-6f0a8f633a4f","resolution":{"observed_at":"2026-08-07T14:25:44.020130Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:25:44.006641Z","title":"Multi-modal twitter data analysis for identifying offensive posts using a deep cross atten- tion based transformer framework,","venue":null,"work_id":"4368d261-09c1-4188-bdb8-c7f20552dad2","year":2025},"citing_paper":{"arxiv_id":"2505.19010","last_updated":"2025-07-30T10:40:17Z","snapshot_observed_at":"2026-08-18T01:30:27.683881Z","submitted_at":"2025-05-25T07:26:00Z","title":"Co-AttenDWG: Co-Attentive Dimension-Wise Gating and Expert Fusion for Multi-Modal Offensive Content Detection","version":2},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-08-07T14:25:40.067162Z"},"links":{"citing_paper":"/paper/2505.19010"},"observation_digest":"sha256:29c4858ca9df83ec867638b0ccf7a35c37131a672814782e7bc0cf94a01bc176","observation_id":"924dd7b5-3204-484c-99ed-2cf634370c1c","resolution":{"observed_at":"2026-08-07T14:25:44.010213Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:25:43.996902Z","title":"Multimodal large language model with lora fine-tuning for multimodal sentiment analysis,","venue":null,"work_id":"f5c0c8c6-d765-42a5-8617-8732f81a0adb","year":2024},"citing_paper":{"arxiv_id":"2505.19010","last_updated":"2025-07-30T10:40:17Z","snapshot_observed_at":"2026-08-18T01:30:27.683881Z","submitted_at":"2025-05-25T07:26:00Z","title":"Co-AttenDWG: Co-Attentive Dimension-Wise Gating and Expert Fusion for Multi-Modal Offensive Content Detection","version":2},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-08-07T14:25:40.137830Z"},"links":{"citing_paper":"/paper/2505.19010"},"observation_digest":"sha256:567c09fd7556eebcd6ca36357140c77416a9e7d182d29b3dab0577ce5f7bbdee","observation_id":"19cedcaf-9350-41c0-8402-9057ca17d359","resolution":{"observed_at":"2026-08-07T14:25:44.000236Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:25:43.986165Z","title":"Image–text sentiment analysis via deep multimodal attentive fusion,","venue":null,"work_id":"1d10066f-1f99-409e-a05e-7aaa701a0096","year":2019},"citing_paper":{"arxiv_id":"2505.19010","last_updated":"2025-07-30T10:40:17Z","snapshot_observed_at":"2026-08-18T01:30:27.683881Z","submitted_at":"2025-05-25T07:26:00Z","title":"Co-AttenDWG: Co-Attentive Dimension-Wise Gating and Expert Fusion for Multi-Modal Offensive Content Detection","version":2},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-08-07T14:25:40.216114Z"},"links":{"citing_paper":"/paper/2505.19010"},"observation_digest":"sha256:db50d3dbd9551924f98979c0b4489a8f77e041199713063e89e46ed67eb889c0","observation_id":"e256ead2-3cde-417b-9d39-4c69b2de92fa","resolution":{"observed_at":"2026-08-07T14:25:43.990351Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:25:43.974509Z","title":"Pars-off: a benchmark for offensive language detec- tion on farsi social media,","venue":null,"work_id":"d9f879ba-9d9b-4c21-bcb2-c45737d085b5","year":2022},"citing_paper":{"arxiv_id":"2505.19010","last_updated":"2025-07-30T10:40:17Z","snapshot_observed_at":"2026-08-18T01:30:27.683881Z","submitted_at":"2025-05-25T07:26:00Z","title":"Co-AttenDWG: Co-Attentive Dimension-Wise Gating and Expert Fusion for Multi-Modal Offensive Content Detection","version":2},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-08-07T14:25:40.263544Z"},"links":{"citing_paper":"/paper/2505.19010"},"observation_digest":"sha256:997e95062229f154fc7c1592c8927b110ff9a92c9ab458eb3cf9773bca0c3a33","observation_id":"e48b2613-2a04-4f89-ac37-67063a941e84","resolution":{"observed_at":"2026-08-07T14:25:43.978578Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:25:43.963966Z","title":"Djmf: A discriminative joint multi-task framework for multimodal sentiment analysis based on intra- and inter-task dynamics,","venue":null,"work_id":"195410fc-3919-4605-a0b1-afc6b2412a99","year":2024},"citing_paper":{"arxiv_id":"2505.19010","last_updated":"2025-07-30T10:40:17Z","snapshot_observed_at":"2026-08-18T01:30:27.683881Z","submitted_at":"2025-05-25T07:26:00Z","title":"Co-AttenDWG: Co-Attentive Dimension-Wise Gating and Expert Fusion for Multi-Modal Offensive Content Detection","version":2},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-08-07T14:25:40.339234Z"},"links":{"citing_paper":"/paper/2505.19010"},"observation_digest":"sha256:d6b066c0e2c440e140ffac360347381a9243f36e0c2b492d210ec5d0af8bff1c","observation_id":"f80807ea-ea4f-4792-a99f-57678393c689","resolution":{"observed_at":"2026-08-07T14:25:43.968244Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:25:43.953242Z","title":"Joint multimodal sentiment analysis based on information relevance,","venue":null,"work_id":"88699fcf-5660-4669-95dd-63cd752e5488","year":2023},"citing_paper":{"arxiv_id":"2505.19010","last_updated":"2025-07-30T10:40:17Z","snapshot_observed_at":"2026-08-18T01:30:27.683881Z","submitted_at":"2025-05-25T07:26:00Z","title":"Co-AttenDWG: Co-Attentive Dimension-Wise Gating and Expert Fusion for Multi-Modal Offensive Content Detection","version":2},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-08-07T14:25:40.447134Z"},"links":{"citing_paper":"/paper/2505.19010"},"observation_digest":"sha256:55b4c094d2eb17b88cc5c55c6dd0b4d5d155bbf58b3217c82945e8c19162eacf","observation_id":"7c3c2271-7254-4da2-b889-e6c1c827665f","resolution":{"observed_at":"2026-08-07T14:25:43.956788Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:25:43.941914Z","title":"Decoding memes: a comprehensive analysis of late and early fusion models for explainable meme analysis,","venue":null,"work_id":"65e37379-c43b-4cdb-ab8c-8e7623958e8e","year":2024},"citing_paper":{"arxiv_id":"2505.19010","last_updated":"2025-07-30T10:40:17Z","snapshot_observed_at":"2026-08-18T01:30:27.683881Z","submitted_at":"2025-05-25T07:26:00Z","title":"Co-AttenDWG: Co-Attentive Dimension-Wise Gating and Expert Fusion for Multi-Modal Offensive Content Detection","version":2},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-08-07T14:25:40.548012Z"},"links":{"citing_paper":"/paper/2505.19010"},"observation_digest":"sha256:866750dbb6310f7393459dbd43128a1766177d474444d8649a7b51a19ad3da64","observation_id":"1cac5b3c-82ce-4f10-8915-069425dd6992","resolution":{"observed_at":"2026-08-07T14:25:43.945663Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:25:43.931297Z","title":"Multimodal sentiment analysis based on fusion methods: A survey,","venue":null,"work_id":"d3101236-c1e7-4e97-b7fb-02cd7b33ef55","year":2023},"citing_paper":{"arxiv_id":"2505.19010","last_updated":"2025-07-30T10:40:17Z","snapshot_observed_at":"2026-08-18T01:30:27.683881Z","submitted_at":"2025-05-25T07:26:00Z","title":"Co-AttenDWG: Co-Attentive Dimension-Wise Gating and Expert Fusion for Multi-Modal Offensive Content Detection","version":2},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-08-07T14:25:40.719080Z"},"links":{"citing_paper":"/paper/2505.19010"},"observation_digest":"sha256:464d148c9a6033091b630f6746af9ad14b1f212e290831731347753ecab3fe83","observation_id":"c1839d22-1d2f-49f5-8cd2-070c29f005bf","resolution":{"observed_at":"2026-08-07T14:25:43.935069Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:25:40.763284Z","title":"Multi- modal sentiment analysis: A systematic review of history, datasets, mul- timodal fusion methods, applications, challenges and future directions,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.19010","last_updated":"2025-07-30T10:40:17Z","snapshot_observed_at":"2026-08-18T01:30:27.683881Z","submitted_at":"2025-05-25T07:26:00Z","title":"Co-AttenDWG: Co-Attentive Dimension-Wise Gating and Expert Fusion for Multi-Modal Offensive Content Detection","version":2},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-08-07T14:25:40.763284Z"},"links":{"citing_paper":"/paper/2505.19010"},"observation_digest":"sha256:9736ea4a1681e12039f794b0313082567e73ad5b61a914d2d354b15521d3662a","observation_id":"3e1398ab-bf55-4472-b599-16a963d673b1","resolution":{"observed_at":"2026-08-07T14:25:40.763284Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:25:43.913625Z","title":"Mm-emor: multi-modal emotion recognition of social media using concatenated deep learning networks,","venue":null,"work_id":"a6179fc0-d622-4147-b1b1-8a7f5f6b9180","year":2023},"citing_paper":{"arxiv_id":"2505.19010","last_updated":"2025-07-30T10:40:17Z","snapshot_observed_at":"2026-08-18T01:30:27.683881Z","submitted_at":"2025-05-25T07:26:00Z","title":"Co-AttenDWG: Co-Attentive Dimension-Wise Gating and Expert Fusion for Multi-Modal Offensive Content Detection","version":2},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-08-07T14:25:40.820598Z"},"links":{"citing_paper":"/paper/2505.19010"},"observation_digest":"sha256:d1917b1a1776a4c14a3daece2252f7db0c9466e5d6cf0332a9c69fbe9691ffb1","observation_id":"787d78ac-3e24-473c-b2e7-813b1d07a987","resolution":{"observed_at":"2026-08-07T14:25:43.918379Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2306.01312","last_updated":"2023-07-31T09:03:40Z","snapshot_observed_at":"2026-08-17T15:16:06.476980Z","submitted_at":"2023-06-02T07:22:43Z","title":"Syntax-aware Hybrid prompt model for Few-shot multi-modal sentiment analysis","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2306.01312","snapshot_observed_at":"2026-08-07T14:25:40.877041Z","title":"Syntax-aware hybrid prompt model for few-shot multi-modal sentiment analysis,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.19010","last_updated":"2025-07-30T10:40:17Z","snapshot_observed_at":"2026-08-18T01:30:27.683881Z","submitted_at":"2025-05-25T07:26:00Z","title":"Co-AttenDWG: Co-Attentive Dimension-Wise Gating and Expert Fusion for Multi-Modal Offensive Content Detection","version":2},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-08-07T14:25:40.877041Z"},"links":{"cited_paper":"/paper/2306.01312","citing_paper":"/paper/2505.19010"},"observation_digest":"sha256:df30a1361c7e3836ef1442d88292fe1a7d012ec203d25ba76c6122f37f05917f","observation_id":"8815cea7-11ac-4991-9b05-e3eb1fff0983","resolution":{"observed_at":"2026-08-07T14:25:40.877041Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:25:43.902852Z","title":"Offensive language detection for low resource language using deep sequence model,","venue":null,"work_id":"1b0fea82-f1d9-44d9-b8f8-aa0495744b69","year":2023},"citing_paper":{"arxiv_id":"2505.19010","last_updated":"2025-07-30T10:40:17Z","snapshot_observed_at":"2026-08-18T01:30:27.683881Z","submitted_at":"2025-05-25T07:26:00Z","title":"Co-AttenDWG: Co-Attentive Dimension-Wise Gating and Expert Fusion for Multi-Modal Offensive Content Detection","version":2},"reference_index":36,"source":"pdf_text","source_observed_at":"2026-08-07T14:25:40.993710Z"},"links":{"citing_paper":"/paper/2505.19010"},"observation_digest":"sha256:d4f2aa7514c2f5d5b49102bfc6fa58cb74216093a53390489e1453937a619013","observation_id":"62ddbb3a-c3ae-48ae-a559-7fddf7ca87e8","resolution":{"observed_at":"2026-08-07T14:25:43.906939Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:25:43.892206Z","title":"Research on multimodal hate speech detection based on self-attention mechanism feature fusion,","venue":null,"work_id":"20dd076b-d74e-468c-a691-7ece6416a5e5","year":2025},"citing_paper":{"arxiv_id":"2505.19010","last_updated":"2025-07-30T10:40:17Z","snapshot_observed_at":"2026-08-18T01:30:27.683881Z","submitted_at":"2025-05-25T07:26:00Z","title":"Co-AttenDWG: Co-Attentive Dimension-Wise Gating and Expert Fusion for Multi-Modal Offensive Content Detection","version":2},"reference_index":37,"source":"pdf_text","source_observed_at":"2026-08-07T14:25:41.057539Z"},"links":{"citing_paper":"/paper/2505.19010"},"observation_digest":"sha256:2d0787c440c53e664a11b4b388b59753f58d753b5346f6dccdd90316c6db4303","observation_id":"89c03910-56f2-4eff-afc3-d261b6131c18","resolution":{"observed_at":"2026-08-07T14:25:43.895778Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:25:43.881463Z","title":"Multi-modal sentiment analysis based on image and text fusion using a cross-attention mechanism,","venue":null,"work_id":"7a648be2-8783-496e-9385-85cd26a416d6","year":2024},"citing_paper":{"arxiv_id":"2505.19010","last_updated":"2025-07-30T10:40:17Z","snapshot_observed_at":"2026-08-18T01:30:27.683881Z","submitted_at":"2025-05-25T07:26:00Z","title":"Co-AttenDWG: Co-Attentive Dimension-Wise Gating and Expert Fusion for Multi-Modal Offensive Content Detection","version":2},"reference_index":38,"source":"pdf_text","source_observed_at":"2026-08-07T14:25:41.090917Z"},"links":{"citing_paper":"/paper/2505.19010"},"observation_digest":"sha256:903f6943660cd7ab936e30d222b35de4c93ee280f7257b313be3356621297670","observation_id":"8cd85a84-b3a1-42b6-9d9f-4c27380292ad","resolution":{"observed_at":"2026-08-07T14:25:43.885467Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:25:43.870296Z","title":"Fusion and discrimina- tion: A multimodal graph contrastive learning framework for multimodal sarcasm detection,","venue":null,"work_id":"348d4bc1-ba17-4439-a013-031f75b4244d","year":2024},"citing_paper":{"arxiv_id":"2505.19010","last_updated":"2025-07-30T10:40:17Z","snapshot_observed_at":"2026-08-18T01:30:27.683881Z","submitted_at":"2025-05-25T07:26:00Z","title":"Co-AttenDWG: Co-Attentive Dimension-Wise Gating and Expert Fusion for Multi-Modal Offensive Content Detection","version":2},"reference_index":39,"source":"pdf_text","source_observed_at":"2026-08-07T14:25:41.181812Z"},"links":{"citing_paper":"/paper/2505.19010"},"observation_digest":"sha256:285a7a003e5f357f7aef87add5ca651db3a54af6ca5274c337fd50a2702db1a7","observation_id":"521a7d7b-7ab5-4c0c-b318-f9d3341605cd","resolution":{"observed_at":"2026-08-07T14:25:43.874199Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:25:41.331681Z","title":"Attention is all you need,","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2505.19010","last_updated":"2025-07-30T10:40:17Z","snapshot_observed_at":"2026-08-18T01:30:27.683881Z","submitted_at":"2025-05-25T07:26:00Z","title":"Co-AttenDWG: Co-Attentive Dimension-Wise Gating and Expert Fusion for Multi-Modal Offensive Content Detection","version":2},"reference_index":40,"source":"pdf_text","source_observed_at":"2026-08-07T14:25:41.331681Z"},"links":{"citing_paper":"/paper/2505.19010"},"observation_digest":"sha256:983d611d54307801bd96598e8a13335de9f77d4234af203f4b45317b45b4ea34","observation_id":"7de52236-f4c7-4a8a-997a-80873bfc2197","resolution":{"observed_at":"2026-08-07T14:25:41.331681Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:25:41.459863Z","title":"Squeeze-and-excitation networks,","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2505.19010","last_updated":"2025-07-30T10:40:17Z","snapshot_observed_at":"2026-08-18T01:30:27.683881Z","submitted_at":"2025-05-25T07:26:00Z","title":"Co-AttenDWG: Co-Attentive Dimension-Wise Gating and Expert Fusion for Multi-Modal Offensive Content Detection","version":2},"reference_index":41,"source":"pdf_text","source_observed_at":"2026-08-07T14:25:41.459863Z"},"links":{"citing_paper":"/paper/2505.19010"},"observation_digest":"sha256:096630644ca0216edf0c5b54c4c6ad88136bf1e3ae9c09993fb1003187c75444","observation_id":"c140f0ea-f23d-4e8c-b59b-82b2663b9dc4","resolution":{"observed_at":"2026-08-07T14:25:41.459863Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1701.06538","last_updated":"2017-01-23T18:10:00Z","snapshot_observed_at":"2026-08-13T11:35:07.866136Z","submitted_at":"2017-01-23T18:10:00Z","title":"Outrageously Large Neural Networks: The Sparsely-Gated Mixture-of-Experts Layer","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1701.06538","snapshot_observed_at":"2026-08-07T14:25:41.565766Z","title":"Outrageously large neural networks: The sparsely-gated mixture-of-experts layer,","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2505.19010","last_updated":"2025-07-30T10:40:17Z","snapshot_observed_at":"2026-08-18T01:30:27.683881Z","submitted_at":"2025-05-25T07:26:00Z","title":"Co-AttenDWG: Co-Attentive Dimension-Wise Gating and Expert Fusion for Multi-Modal Offensive Content Detection","version":2},"reference_index":42,"source":"pdf_text","source_observed_at":"2026-08-07T14:25:41.565766Z"},"links":{"cited_paper":"/paper/1701.06538","citing_paper":"/paper/2505.19010"},"observation_digest":"sha256:fe91bd02f529b706e589d67dcb9eafca0d44a1c622c7f42e2fb7279f39019ac0","observation_id":"9721a778-daa1-4e1d-9eda-760fcdebc20f","resolution":{"observed_at":"2026-08-07T14:25:41.565766Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1607.06450","last_updated":"2016-07-21T19:57:52Z","snapshot_observed_at":"2026-08-15T04:53:45.483331Z","submitted_at":"2016-07-21T19:57:52Z","title":"Layer Normalization","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1607.06450","snapshot_observed_at":"2026-08-07T14:25:41.665332Z","title":"Layer normalization,","venue":null,"work_id":null,"year":2016},"citing_paper":{"arxiv_id":"2505.19010","last_updated":"2025-07-30T10:40:17Z","snapshot_observed_at":"2026-08-18T01:30:27.683881Z","submitted_at":"2025-05-25T07:26:00Z","title":"Co-AttenDWG: Co-Attentive Dimension-Wise Gating and Expert Fusion for Multi-Modal Offensive Content Detection","version":2},"reference_index":43,"source":"pdf_text","source_observed_at":"2026-08-07T14:25:41.665332Z"},"links":{"cited_paper":"/paper/1607.06450","citing_paper":"/paper/2505.19010"},"observation_digest":"sha256:9df1d584c382e59ea68da0b327ab57008e5543afc1f0bf9e18bf3855689adb76","observation_id":"f0386b78-c883-4dcc-b185-0528fdbbc1c4","resolution":{"observed_at":"2026-08-07T14:25:41.665332Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1910.01108","last_updated":"2020-03-01T02:57:50Z","snapshot_observed_at":"2026-08-07T19:07:36.327251Z","submitted_at":"2019-10-02T17:56:28Z","title":"DistilBERT, a distilled version of BERT: smaller, faster, cheaper and lighter","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1910.01108","snapshot_observed_at":"2026-08-07T14:25:41.789784Z","title":"Distilbert, a distilled version of bert: smaller, faster, cheaper and lighter,","venue":null,"work_id":null,"year":1910},"citing_paper":{"arxiv_id":"2505.19010","last_updated":"2025-07-30T10:40:17Z","snapshot_observed_at":"2026-08-18T01:30:27.683881Z","submitted_at":"2025-05-25T07:26:00Z","title":"Co-AttenDWG: Co-Attentive Dimension-Wise Gating and Expert Fusion for Multi-Modal Offensive Content Detection","version":2},"reference_index":44,"source":"pdf_text","source_observed_at":"2026-08-07T14:25:41.789784Z"},"links":{"cited_paper":"/paper/1910.01108","citing_paper":"/paper/2505.19010"},"observation_digest":"sha256:1aa22c0b8d578fa4c4a0bd70c03bd52d4aa63756afe2d28872ba6e0075d5b5db","observation_id":"32841303-9c34-4cd8-a6ca-6df8dc9fb3d4","resolution":{"observed_at":"2026-08-07T14:25:41.789784Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1409.1556","last_updated":"2015-04-10T16:25:04Z","snapshot_observed_at":"2026-08-17T19:17:06.411141Z","submitted_at":"2014-09-04T19:48:04Z","title":"Very Deep Convolutional Networks for Large-Scale Image Recognition","version":6},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1409.1556","snapshot_observed_at":"2026-08-07T14:25:41.901458Z","title":"Very deep convolutional networks for large-scale image recognition,","venue":null,"work_id":null,"year":2014},"citing_paper":{"arxiv_id":"2505.19010","last_updated":"2025-07-30T10:40:17Z","snapshot_observed_at":"2026-08-18T01:30:27.683881Z","submitted_at":"2025-05-25T07:26:00Z","title":"Co-AttenDWG: Co-Attentive Dimension-Wise Gating and Expert Fusion for Multi-Modal Offensive Content Detection","version":2},"reference_index":45,"source":"pdf_text","source_observed_at":"2026-08-07T14:25:41.901458Z"},"links":{"cited_paper":"/paper/1409.1556","citing_paper":"/paper/2505.19010"},"observation_digest":"sha256:a10a663436b0a0a2a1d19df75a1ab7e9f9513977dce9949be7fd540a7735b0b6","observation_id":"345bc459-e513-4b40-b9fa-2c4b7f37b9d5","resolution":{"observed_at":"2026-08-07T14:25:41.901458Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:25:43.760915Z","title":"Efficientnetv2: Smaller models and faster training,","venue":null,"work_id":"e7c15090-bc48-4381-942a-006102d619a8","year":2021},"citing_paper":{"arxiv_id":"2505.19010","last_updated":"2025-07-30T10:40:17Z","snapshot_observed_at":"2026-08-18T01:30:27.683881Z","submitted_at":"2025-05-25T07:26:00Z","title":"Co-AttenDWG: Co-Attentive Dimension-Wise Gating and Expert Fusion for Multi-Modal Offensive Content Detection","version":2},"reference_index":46,"source":"pdf_text","source_observed_at":"2026-08-07T14:25:42.053846Z"},"links":{"citing_paper":"/paper/2505.19010"},"observation_digest":"sha256:67baad5bd18e10c418a3e436a7e95a9c641ecf3c9d867182259aa52bfde7ad29","observation_id":"0f379533-6fe3-4b33-a10c-f9f43f207ea9","resolution":{"observed_at":"2026-08-07T14:25:43.846765Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:25:43.535860Z","title":"Unsupervised cross-lingual representation learning at scale,","venue":null,"work_id":"04f9143b-e8df-4e6b-84ab-b81332c20d56","year":2019},"citing_paper":{"arxiv_id":"2505.19010","last_updated":"2025-07-30T10:40:17Z","snapshot_observed_at":"2026-08-18T01:30:27.683881Z","submitted_at":"2025-05-25T07:26:00Z","title":"Co-AttenDWG: Co-Attentive Dimension-Wise Gating and Expert Fusion for Multi-Modal Offensive Content Detection","version":2},"reference_index":47,"source":"pdf_text","source_observed_at":"2026-08-07T14:25:42.156831Z"},"links":{"citing_paper":"/paper/2505.19010"},"observation_digest":"sha256:77e30babe3358ac684151b1e79a47ae133316e5fddffd6556e28decaeb9ac9e5","observation_id":"26927944-0c9c-474a-980c-536ddc2e9062","resolution":{"observed_at":"2026-08-07T14:25:43.613111Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:25:42.254379Z","title":"Learning transferable visual models from natural language supervision,","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2505.19010","last_updated":"2025-07-30T10:40:17Z","snapshot_observed_at":"2026-08-18T01:30:27.683881Z","submitted_at":"2025-05-25T07:26:00Z","title":"Co-AttenDWG: Co-Attentive Dimension-Wise Gating and Expert Fusion for Multi-Modal Offensive Content Detection","version":2},"reference_index":48,"source":"pdf_text","source_observed_at":"2026-08-07T14:25:42.254379Z"},"links":{"citing_paper":"/paper/2505.19010"},"observation_digest":"sha256:a6b38f316e56d42d805f07d658c42ea6c7274749f563ee1c47301cd8053d6800","observation_id":"e91d9004-aa73-4683-9e67-a1b98d9f00e6","resolution":{"observed_at":"2026-08-07T14:25:42.254379Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:25:42.368041Z","title":"Align before fuse: Vision and language representation learning with momentum distillation,","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2505.19010","last_updated":"2025-07-30T10:40:17Z","snapshot_observed_at":"2026-08-18T01:30:27.683881Z","submitted_at":"2025-05-25T07:26:00Z","title":"Co-AttenDWG: Co-Attentive Dimension-Wise Gating and Expert Fusion for Multi-Modal Offensive Content Detection","version":2},"reference_index":49,"source":"pdf_text","source_observed_at":"2026-08-07T14:25:42.368041Z"},"links":{"citing_paper":"/paper/2505.19010"},"observation_digest":"sha256:818b33572058fcba38fc58278a2a6055e8980ea864a8cc271987dcc91dca08d9","observation_id":"75e1c397-4e51-4842-8322-de58d87ca50e","resolution":{"observed_at":"2026-08-07T14:25:42.368041Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:25:42.505072Z","title":"Blip: Bootstrapping language-image pre-training for unified vision-language understanding and generation,","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2505.19010","last_updated":"2025-07-30T10:40:17Z","snapshot_observed_at":"2026-08-18T01:30:27.683881Z","submitted_at":"2025-05-25T07:26:00Z","title":"Co-AttenDWG: Co-Attentive Dimension-Wise Gating and Expert Fusion for Multi-Modal Offensive Content Detection","version":2},"reference_index":50,"source":"pdf_text","source_observed_at":"2026-08-07T14:25:42.505072Z"},"links":{"citing_paper":"/paper/2505.19010"},"observation_digest":"sha256:e60554a78ab5b197f1f39fc62fe8029610a5d8dee35277f7b17d8a1c7415d638","observation_id":"2917c82c-04dd-4a1a-a83f-d3b8485219ce","resolution":{"observed_at":"2026-08-07T14:25:42.505072Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:25:43.353728Z","title":"Task report: Memotion analysis 1.0@ semeval 2020: The visuo-lingual metaphor,","venue":null,"work_id":"96f94acd-6781-41ac-8481-0ddfa9f85071","year":2020},"citing_paper":{"arxiv_id":"2505.19010","last_updated":"2025-07-30T10:40:17Z","snapshot_observed_at":"2026-08-18T01:30:27.683881Z","submitted_at":"2025-05-25T07:26:00Z","title":"Co-AttenDWG: Co-Attentive Dimension-Wise Gating and Expert Fusion for Multi-Modal Offensive Content Detection","version":2},"reference_index":51,"source":"pdf_text","source_observed_at":"2026-08-07T14:25:42.601322Z"},"links":{"citing_paper":"/paper/2505.19010"},"observation_digest":"sha256:6b83b49e9052c08e2de959f4b5b7848147409107474aed1628c4ae8c91446769","observation_id":"7c72eb09-ef45-438d-bd65-bd13d7fa27ce","resolution":{"observed_at":"2026-08-07T14:25:43.464721Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:25:43.142128Z","title":"Mimic: misogyny identification in multimodal internet content in hindi-english code-mixed language,","venue":null,"work_id":"83ef93fe-ba8c-4034-af05-5f2b2f12f368","year":2024},"citing_paper":{"arxiv_id":"2505.19010","last_updated":"2025-07-30T10:40:17Z","snapshot_observed_at":"2026-08-18T01:30:27.683881Z","submitted_at":"2025-05-25T07:26:00Z","title":"Co-AttenDWG: Co-Attentive Dimension-Wise Gating and Expert Fusion for Multi-Modal Offensive Content Detection","version":2},"reference_index":52,"source":"pdf_text","source_observed_at":"2026-08-07T14:25:42.697041Z"},"links":{"citing_paper":"/paper/2505.19010"},"observation_digest":"sha256:dca21434628e117e77add395c107e619cbd01870823381582ba942a4743ecd51","observation_id":"34dc37ce-0518-45bc-b2de-3014a1c73e59","resolution":{"observed_at":"2026-08-07T14:25:43.227741Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}}],"paper":{"arxiv_id":"2505.19010","last_updated":"2025-07-30T10:40:17Z","latest_version":2,"primary_category":"cs.CV","snapshot_observed_at":"2026-08-18T01:30:27.683881Z","submitted_at":"2025-05-25T07:26:00Z","title":"Co-AttenDWG: Co-Attentive Dimension-Wise Gating and Expert Fusion for Multi-Modal Offensive Content Detection"},"reference_resolution":{"displayed":52,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":21,"verified_exact":1,"verified_fuzzy":30},"total_outbound_references":52},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"thesis":"As of 19 August 2026, this Paper Citation Record lists 52 of 52 outbound references and 0 inbound Pith citation observations for arXiv:2505.19010."}