{"as_of":"2026-08-09T13:15:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:b9c18c0076c796ca8a1c3efed1aa40789e9ee860b3ef91b07383e05ae7712b4a","coverage":[{"denominator":49,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":49,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-08T13:44:02.957029Z","state":"measured"},{"denominator":49,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":49,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-09T06:31:02.800959+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2502.07138/citation-record","integrity":"/paper/2502.07138/integrity","json":"/paper/2502.07138/citation-record.json","paper":"/paper/2502.07138"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T13:44:02.551998Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2502.07138","last_updated":"2025-02-11T00:07:40Z","snapshot_observed_at":"2026-08-08T13:39:16.436016Z","submitted_at":"2025-02-11T00:07:40Z","title":"Towards a Robust Framework for Multimodal Hate Detection: A Study on Video vs. Image-based Content","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-08T13:44:02.551998Z"},"links":{"citing_paper":"/paper/2502.07138"},"observation_digest":"sha256:14d4298c7df61748d1d791539d6322def0e2bfd9d68ac8c4ce44828a53033e07","observation_id":"85109b7e-b75c-48b8-86af-c0ffcafd75b1","resolution":{"observed_at":"2026-08-08T13:44:02.551998Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T13:44:03.879256Z","title":null,"venue":null,"work_id":"457b7f77-df00-4983-b0b4-a3935082aee9","year":2024},"citing_paper":{"arxiv_id":"2502.07138","last_updated":"2025-02-11T00:07:40Z","snapshot_observed_at":"2026-08-08T13:39:16.436016Z","submitted_at":"2025-02-11T00:07:40Z","title":"Towards a Robust Framework for Multimodal Hate Detection: A Study on Video vs. Image-based Content","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-08T13:44:02.562650Z"},"links":{"citing_paper":"/paper/2502.07138"},"observation_digest":"sha256:ba673224729b262c639a4de19a6dbb57beadebaba77e0b2ce4d29b50c80c58e4","observation_id":"f877a3b5-e74c-4a42-ae81-fedc8f34b293","resolution":{"observed_at":"2026-08-08T13:44:03.884482Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2308.01390","last_updated":"2023-08-07T17:53:09Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2023-08-02T19:10:23Z","title":"OpenFlamingo: An Open-Source Framework for Training Large Autoregressive Vision-Language Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2308.01390","snapshot_observed_at":"2026-08-08T13:44:02.568136Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2502.07138","last_updated":"2025-02-11T00:07:40Z","snapshot_observed_at":"2026-08-08T13:39:16.436016Z","submitted_at":"2025-02-11T00:07:40Z","title":"Towards a Robust Framework for Multimodal Hate Detection: A Study on Video vs. Image-based Content","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-08T13:44:02.568136Z"},"links":{"cited_paper":"/paper/2308.01390","citing_paper":"/paper/2502.07138"},"observation_digest":"sha256:bc58db98f9d763bdba8b4578582117e417a63ec5559d1cbe90c16f3f0d4e7407","observation_id":"56d4ded1-5fcb-4c72-a63c-d0a94ebb1992","resolution":{"observed_at":"2026-08-08T13:44:02.568136Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T13:44:03.863843Z","title":null,"venue":null,"work_id":"77745273-0f3b-4fc6-ae52-bff711f613ad","year":2023},"citing_paper":{"arxiv_id":"2502.07138","last_updated":"2025-02-11T00:07:40Z","snapshot_observed_at":"2026-08-08T13:39:16.436016Z","submitted_at":"2025-02-11T00:07:40Z","title":"Towards a Robust Framework for Multimodal Hate Detection: A Study on Video vs. Image-based Content","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-08T13:44:02.573571Z"},"links":{"citing_paper":"/paper/2502.07138"},"observation_digest":"sha256:1f6d68ad4fbc64c4c59f67244869ab9caf33fffca181d7606ade19892dc8c162","observation_id":"c3afa1f1-a48a-46d0-a592-bf4dde694a99","resolution":{"observed_at":"2026-08-08T13:44:03.868561Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T13:44:02.578371Z","title":null,"venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2502.07138","last_updated":"2025-02-11T00:07:40Z","snapshot_observed_at":"2026-08-08T13:39:16.436016Z","submitted_at":"2025-02-11T00:07:40Z","title":"Towards a Robust Framework for Multimodal Hate Detection: A Study on Video vs. Image-based Content","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-08T13:44:02.578371Z"},"links":{"citing_paper":"/paper/2502.07138"},"observation_digest":"sha256:5b69c23f271f088850919b45cabf941feba8f1a222f60d83d1512a0c601d8ef5","observation_id":"55db15f7-582a-455b-bb6a-845bc7897ba6","resolution":{"observed_at":"2026-08-08T13:44:02.578371Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T13:44:03.837820Z","title":null,"venue":null,"work_id":"c1699a98-5e1d-411d-895d-61a75a68c0e3","year":2023},"citing_paper":{"arxiv_id":"2502.07138","last_updated":"2025-02-11T00:07:40Z","snapshot_observed_at":"2026-08-08T13:39:16.436016Z","submitted_at":"2025-02-11T00:07:40Z","title":"Towards a Robust Framework for Multimodal Hate Detection: A Study on Video vs. Image-based Content","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-08T13:44:02.618676Z"},"links":{"citing_paper":"/paper/2502.07138"},"observation_digest":"sha256:37e74232ca0e02b9ce3bd192e6b84dce46f19213236e2af948a3b6991cc2b304","observation_id":"123c028b-b301-4130-8b33-4d3c033d0a11","resolution":{"observed_at":"2026-08-08T13:44:03.842966Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T13:44:03.821658Z","title":null,"venue":null,"work_id":"63876fb7-833e-4513-81f3-ec8025cc8a49","year":2023},"citing_paper":{"arxiv_id":"2502.07138","last_updated":"2025-02-11T00:07:40Z","snapshot_observed_at":"2026-08-08T13:39:16.436016Z","submitted_at":"2025-02-11T00:07:40Z","title":"Towards a Robust Framework for Multimodal Hate Detection: A Study on Video vs. Image-based Content","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-08T13:44:02.671810Z"},"links":{"citing_paper":"/paper/2502.07138"},"observation_digest":"sha256:0ccb0c970a1b21707324ebbec23fe5c78c93f7a5e3fc389446ed83335ad7d594","observation_id":"e303fed2-763a-4ba9-93bc-5049baaaaa9c","resolution":{"observed_at":"2026-08-08T13:44:03.826594Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T13:44:03.806531Z","title":null,"venue":null,"work_id":"1df183f7-4fb6-47b6-8a8b-6d3735c4f411","year":2024},"citing_paper":{"arxiv_id":"2502.07138","last_updated":"2025-02-11T00:07:40Z","snapshot_observed_at":"2026-08-08T13:39:16.436016Z","submitted_at":"2025-02-11T00:07:40Z","title":"Towards a Robust Framework for Multimodal Hate Detection: A Study on Video vs. Image-based Content","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-08T13:44:02.689677Z"},"links":{"citing_paper":"/paper/2502.07138"},"observation_digest":"sha256:71686e85a43552ee4f98255a66af4bea7d157ece1e76f54571f9245dc77bb1a5","observation_id":"65d35e3a-6efb-46e0-ab66-c95a1b169c70","resolution":{"observed_at":"2026-08-08T13:44:03.811265Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T13:44:03.791154Z","title":null,"venue":null,"work_id":"13e948a0-43c5-42bd-b982-f2eb9fa43a5a","year":2023},"citing_paper":{"arxiv_id":"2502.07138","last_updated":"2025-02-11T00:07:40Z","snapshot_observed_at":"2026-08-08T13:39:16.436016Z","submitted_at":"2025-02-11T00:07:40Z","title":"Towards a Robust Framework for Multimodal Hate Detection: A Study on Video vs. Image-based Content","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-08T13:44:02.702192Z"},"links":{"citing_paper":"/paper/2502.07138"},"observation_digest":"sha256:d603d23b2b9af148f97cbef88efc47ddac3fbb28ebd88b61cc869baa32ff2b1c","observation_id":"9f7517d0-6759-445c-89a4-e8c3605badb0","resolution":{"observed_at":"2026-08-08T13:44:03.796009Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T13:44:03.776300Z","title":null,"venue":null,"work_id":"984c47b2-a686-497e-85bb-08ef8fe5c83a","year":2023},"citing_paper":{"arxiv_id":"2502.07138","last_updated":"2025-02-11T00:07:40Z","snapshot_observed_at":"2026-08-08T13:39:16.436016Z","submitted_at":"2025-02-11T00:07:40Z","title":"Towards a Robust Framework for Multimodal Hate Detection: A Study on Video vs. Image-based Content","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-08T13:44:02.711073Z"},"links":{"citing_paper":"/paper/2502.07138"},"observation_digest":"sha256:92bb5fdc2f29f122db9b851ac61ae03aa5fe9fefd21788c557808a8332474b35","observation_id":"7a748ef9-4421-4994-8fd3-fe5660a78f55","resolution":{"observed_at":"2026-08-08T13:44:03.780842Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T13:44:03.761584Z","title":null,"venue":null,"work_id":"dbda764c-a54c-4697-95a3-3785c5684e16","year":2021},"citing_paper":{"arxiv_id":"2502.07138","last_updated":"2025-02-11T00:07:40Z","snapshot_observed_at":"2026-08-08T13:39:16.436016Z","submitted_at":"2025-02-11T00:07:40Z","title":"Towards a Robust Framework for Multimodal Hate Detection: A Study on Video vs. Image-based Content","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-08T13:44:02.725708Z"},"links":{"citing_paper":"/paper/2502.07138"},"observation_digest":"sha256:03a8eeb22b1fc7f8ec194ae1d6fb6ae919e1a2c3549e7f41812dee05e8edf452","observation_id":"4c94d001-636e-478e-bf0c-b839bfbfae5e","resolution":{"observed_at":"2026-08-08T13:44:03.766471Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T13:44:02.750318Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2502.07138","last_updated":"2025-02-11T00:07:40Z","snapshot_observed_at":"2026-08-08T13:39:16.436016Z","submitted_at":"2025-02-11T00:07:40Z","title":"Towards a Robust Framework for Multimodal Hate Detection: A Study on Video vs. Image-based Content","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-08T13:44:02.750318Z"},"links":{"citing_paper":"/paper/2502.07138"},"observation_digest":"sha256:2aaa74864c30ec5b8d95be8ce194b23324510ce36288c7ed25f2923f49954835","observation_id":"e8019a53-9fe2-4b69-b34c-3a1445fa719e","resolution":{"observed_at":"2026-08-08T13:44:02.750318Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T13:44:03.736959Z","title":null,"venue":null,"work_id":"d0627e4d-32b8-4b92-8596-8688f4a98ba5","year":1980},"citing_paper":{"arxiv_id":"2502.07138","last_updated":"2025-02-11T00:07:40Z","snapshot_observed_at":"2026-08-08T13:39:16.436016Z","submitted_at":"2025-02-11T00:07:40Z","title":"Towards a Robust Framework for Multimodal Hate Detection: A Study on Video vs. Image-based Content","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-08T13:44:02.769381Z"},"links":{"citing_paper":"/paper/2502.07138"},"observation_digest":"sha256:c9a15e430057f2ff6248e8ee2bb9f140fde3c346f798c4f0a155ff512bb842d7","observation_id":"a6795801-d1e1-4a85-9160-e32be87e5368","resolution":{"observed_at":"2026-08-08T13:44:03.742710Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T13:44:03.721711Z","title":null,"venue":null,"work_id":"d7ebbad4-f222-4860-8de2-c7d5ce7f0e54","year":null},"citing_paper":{"arxiv_id":"2502.07138","last_updated":"2025-02-11T00:07:40Z","snapshot_observed_at":"2026-08-08T13:39:16.436016Z","submitted_at":"2025-02-11T00:07:40Z","title":"Towards a Robust Framework for Multimodal Hate Detection: A Study on Video vs. Image-based Content","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-08T13:44:02.785147Z"},"links":{"citing_paper":"/paper/2502.07138"},"observation_digest":"sha256:8c0fd14bd770d7242dc2061ccc5b2f1d755772b45816bfa2c3841abe77c0c199","observation_id":"34897c64-da11-4c2d-b803-ff875df3de98","resolution":{"observed_at":"2026-08-08T13:44:03.726439Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1810.04805","last_updated":"2019-05-24T20:37:26Z","snapshot_observed_at":"2026-07-30T09:12:38.100527Z","submitted_at":"2018-10-11T00:50:01Z","title":"BERT: Pre-training of Deep Bidirectional Transformers for Language Understanding","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1810.04805","snapshot_observed_at":"2026-08-08T13:44:02.801532Z","title":null,"venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2502.07138","last_updated":"2025-02-11T00:07:40Z","snapshot_observed_at":"2026-08-08T13:39:16.436016Z","submitted_at":"2025-02-11T00:07:40Z","title":"Towards a Robust Framework for Multimodal Hate Detection: A Study on Video vs. Image-based Content","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-08T13:44:02.801532Z"},"links":{"cited_paper":"/paper/1810.04805","citing_paper":"/paper/2502.07138"},"observation_digest":"sha256:79808b81e395749f30e5c3fab362986d97842164168c5efb0489234f6f1ee608","observation_id":"9e24a7bf-6ee8-4dd7-a237-b677d2403680","resolution":{"observed_at":"2026-08-08T13:44:02.801532Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2010.11929","last_updated":"2021-06-03T13:08:56Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2020-10-22T17:55:59Z","title":"An Image is Worth 16x16 Words: Transformers for Image Recognition at Scale","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2010.11929","snapshot_observed_at":"2026-08-08T13:44:02.806554Z","title":null,"venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2502.07138","last_updated":"2025-02-11T00:07:40Z","snapshot_observed_at":"2026-08-08T13:39:16.436016Z","submitted_at":"2025-02-11T00:07:40Z","title":"Towards a Robust Framework for Multimodal Hate Detection: A Study on Video vs. Image-based Content","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-08T13:44:02.806554Z"},"links":{"cited_paper":"/paper/2010.11929","citing_paper":"/paper/2502.07138"},"observation_digest":"sha256:6c1c1d698167b6e2eeb25dfdac276d017615d7d20c83f13091b0b33ae54bb387","observation_id":"913c29fb-8b41-45e9-a2b1-7575e6f72fd9","resolution":{"observed_at":"2026-08-08T13:44:02.806554Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T13:44:02.811364Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2502.07138","last_updated":"2025-02-11T00:07:40Z","snapshot_observed_at":"2026-08-08T13:39:16.436016Z","submitted_at":"2025-02-11T00:07:40Z","title":"Towards a Robust Framework for Multimodal Hate Detection: A Study on Video vs. Image-based Content","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-08T13:44:02.811364Z"},"links":{"citing_paper":"/paper/2502.07138"},"observation_digest":"sha256:3883d558b4bb6ce977f393282b00c9e038dbaa1dc8a95472cf6b1792e751cb64","observation_id":"1ea16036-65fd-419d-8505-af763fc1d2d8","resolution":{"observed_at":"2026-08-08T13:44:02.811364Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T13:44:03.686969Z","title":null,"venue":null,"work_id":"d7cda7ab-f06c-4c47-82f1-592d8fc63968","year":2018},"citing_paper":{"arxiv_id":"2502.07138","last_updated":"2025-02-11T00:07:40Z","snapshot_observed_at":"2026-08-08T13:39:16.436016Z","submitted_at":"2025-02-11T00:07:40Z","title":"Towards a Robust Framework for Multimodal Hate Detection: A Study on Video vs. Image-based Content","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-08T13:44:02.821685Z"},"links":{"citing_paper":"/paper/2502.07138"},"observation_digest":"sha256:03e9f0dc81fe2f2e5c4b1b626dc48336c724032a0852147020ce7387c48b2f5f","observation_id":"cda2cce9-24c1-430b-ba1e-32bb0214a1fa","resolution":{"observed_at":"2026-08-08T13:44:03.691689Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T13:44:03.672118Z","title":null,"venue":null,"work_id":"5384979d-cf8e-47c7-9e5f-145f17f7e2c4","year":2020},"citing_paper":{"arxiv_id":"2502.07138","last_updated":"2025-02-11T00:07:40Z","snapshot_observed_at":"2026-08-08T13:39:16.436016Z","submitted_at":"2025-02-11T00:07:40Z","title":"Towards a Robust Framework for Multimodal Hate Detection: A Study on Video vs. Image-based Content","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-08T13:44:02.826428Z"},"links":{"citing_paper":"/paper/2502.07138"},"observation_digest":"sha256:8b74b78a307dc8c9b6a84cde86ec4b5d83ab352a260cd02861abdb61f5e0aac9","observation_id":"001f89de-9f57-4112-bb2d-04735d61e784","resolution":{"observed_at":"2026-08-08T13:44:03.676814Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T13:44:03.656815Z","title":null,"venue":null,"work_id":"7136279a-5775-4843-8ea3-ce7d1657bc8e","year":2018},"citing_paper":{"arxiv_id":"2502.07138","last_updated":"2025-02-11T00:07:40Z","snapshot_observed_at":"2026-08-08T13:39:16.436016Z","submitted_at":"2025-02-11T00:07:40Z","title":"Towards a Robust Framework for Multimodal Hate Detection: A Study on Video vs. Image-based Content","version":1},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-08T13:44:02.831014Z"},"links":{"citing_paper":"/paper/2502.07138"},"observation_digest":"sha256:dd0d0f97148f0ab49b7b04dacdb983405d9972950f9fda6471123b6c935045ea","observation_id":"88ce3ce4-91ec-471d-82d8-7f9fe995c04b","resolution":{"observed_at":"2026-08-08T13:44:03.661772Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2305.17678","last_updated":"2023-06-19T17:07:33Z","snapshot_observed_at":"2026-08-03T16:33:40.847972Z","submitted_at":"2023-05-28T10:02:59Z","title":"Decoding the Underlying Meaning of Multimodal Hateful Memes","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2305.17678","snapshot_observed_at":"2026-08-08T13:44:02.835739Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2502.07138","last_updated":"2025-02-11T00:07:40Z","snapshot_observed_at":"2026-08-08T13:39:16.436016Z","submitted_at":"2025-02-11T00:07:40Z","title":"Towards a Robust Framework for Multimodal Hate Detection: A Study on Video vs. Image-based Content","version":1},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-08T13:44:02.835739Z"},"links":{"cited_paper":"/paper/2305.17678","citing_paper":"/paper/2502.07138"},"observation_digest":"sha256:363c343d8ae85cbc128963fd4d4110fcea4bdf3a7d6d2d3bacc39843a60d5d9b","observation_id":"1832bbf7-b811-4a47-a6dc-281a70ee6dba","resolution":{"observed_at":"2026-08-08T13:44:02.835739Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T13:44:02.840786Z","title":null,"venue":null,"work_id":null,"year":1997},"citing_paper":{"arxiv_id":"2502.07138","last_updated":"2025-02-11T00:07:40Z","snapshot_observed_at":"2026-08-08T13:39:16.436016Z","submitted_at":"2025-02-11T00:07:40Z","title":"Towards a Robust Framework for Multimodal Hate Detection: A Study on Video vs. Image-based Content","version":1},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-08T13:44:02.840786Z"},"links":{"citing_paper":"/paper/2502.07138"},"observation_digest":"sha256:5d6374d7260044027049644fd8ded542090a33c12891252a4716730662ce41a3","observation_id":"97822297-1269-49a8-9b7c-3d0493aae1c4","resolution":{"observed_at":"2026-08-08T13:44:02.840786Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2312.03052","last_updated":"2024-04-05T04:33:23Z","snapshot_observed_at":"2026-07-06T16:57:26.338676Z","submitted_at":"2023-12-05T18:58:37Z","title":"Visual Program Distillation: Distilling Tools and Programmatic Reasoning into Vision-Language Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2312.03052","snapshot_observed_at":"2026-08-08T13:44:02.845652Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2502.07138","last_updated":"2025-02-11T00:07:40Z","snapshot_observed_at":"2026-08-08T13:39:16.436016Z","submitted_at":"2025-02-11T00:07:40Z","title":"Towards a Robust Framework for Multimodal Hate Detection: A Study on Video vs. Image-based Content","version":1},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-08T13:44:02.845652Z"},"links":{"cited_paper":"/paper/2312.03052","citing_paper":"/paper/2502.07138"},"observation_digest":"sha256:d0b5661f4825dbd4651b0bd9252424f90c08a04871c1942cb1c98b3f684c089d","observation_id":"b7a6cb1d-b927-4521-b56a-e22203e74c63","resolution":{"observed_at":"2026-08-08T13:44:02.845652Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2407.21004","last_updated":"2025-01-21T05:31:45Z","snapshot_observed_at":"2026-08-07T20:06:51.762641Z","submitted_at":"2024-07-30T17:51:44Z","title":"Evolver: Chain-of-Evolution Prompting to Boost Large Multimodal Models for Hateful Meme Detection","version":3},"cited_work":{"arxiv_id":"2407.21004","doi":null,"metadata_source":"pith","pith_arxiv_id":"2407.21004","snapshot_observed_at":"2026-08-08T13:44:03.359925Z","title":"Evolver: Chain-of-Evolution Prompting to Boost Large Multimodal Models for Hateful Meme Detection","venue":"cs.CL","work_id":"7ce36e7d-43eb-4fae-a3e6-c096a28b1dbe","year":2024},"citing_paper":{"arxiv_id":"2502.07138","last_updated":"2025-02-11T00:07:40Z","snapshot_observed_at":"2026-08-08T13:39:16.436016Z","submitted_at":"2025-02-11T00:07:40Z","title":"Towards a Robust Framework for Multimodal Hate Detection: A Study on Video vs. Image-based Content","version":1},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-08T13:44:02.850643Z"},"links":{"cited_paper":"/paper/2407.21004","citing_paper":"/paper/2502.07138"},"observation_digest":"sha256:b6ea91ae98376a9fd1fb784b6d3a456e017aea77c0cd07e61f7cb0d63aa05b52","observation_id":"3519af7b-a9f0-44b7-98c1-507786aa7f07","resolution":{"observed_at":"2026-08-08T13:44:03.365281Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T13:44:03.631621Z","title":null,"venue":null,"work_id":"8af39951-aa1a-4ee4-8281-db3ea7467aff","year":2020},"citing_paper":{"arxiv_id":"2502.07138","last_updated":"2025-02-11T00:07:40Z","snapshot_observed_at":"2026-08-08T13:39:16.436016Z","submitted_at":"2025-02-11T00:07:40Z","title":"Towards a Robust Framework for Multimodal Hate Detection: A Study on Video vs. Image-based Content","version":1},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-08-08T13:44:02.855572Z"},"links":{"citing_paper":"/paper/2502.07138"},"observation_digest":"sha256:0aba50981cb6cf39326a403d366ce4a46a2eb460b63d58595cc1896a669e0a93","observation_id":"4ff5070d-f043-4e45-b7f8-756edf507bb4","resolution":{"observed_at":"2026-08-08T13:44:03.636431Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2210.05916","last_updated":"2022-10-17T10:29:03Z","snapshot_observed_at":"2026-07-06T14:04:01.312283Z","submitted_at":"2022-10-12T04:34:54Z","title":"Hate-CLIPper: Multimodal Hateful Meme Classification based on Cross-modal Interaction of CLIP Features","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2210.05916","snapshot_observed_at":"2026-08-08T13:44:02.860094Z","title":null,"venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2502.07138","last_updated":"2025-02-11T00:07:40Z","snapshot_observed_at":"2026-08-08T13:39:16.436016Z","submitted_at":"2025-02-11T00:07:40Z","title":"Towards a Robust Framework for Multimodal Hate Detection: A Study on Video vs. Image-based Content","version":1},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-08-08T13:44:02.860094Z"},"links":{"cited_paper":"/paper/2210.05916","citing_paper":"/paper/2502.07138"},"observation_digest":"sha256:158a02ee405eea88c2aa137a03faf1f2adf33f57e78ca1af3ce4e2fe03f5e000","observation_id":"96507c6d-3b0b-4247-be87-f9f09da298b9","resolution":{"observed_at":"2026-08-08T13:44:02.860094Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1910.13461","last_updated":"2019-10-29T18:01:00Z","snapshot_observed_at":"2026-07-06T08:33:12.534026Z","submitted_at":"2019-10-29T18:01:00Z","title":"BART: Denoising Sequence-to-Sequence Pre-training for Natural Language Generation, Translation, and Comprehension","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1910.13461","snapshot_observed_at":"2026-08-08T13:44:02.865032Z","title":null,"venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2502.07138","last_updated":"2025-02-11T00:07:40Z","snapshot_observed_at":"2026-08-08T13:39:16.436016Z","submitted_at":"2025-02-11T00:07:40Z","title":"Towards a Robust Framework for Multimodal Hate Detection: A Study on Video vs. Image-based Content","version":1},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-08-08T13:44:02.865032Z"},"links":{"cited_paper":"/paper/1910.13461","citing_paper":"/paper/2502.07138"},"observation_digest":"sha256:b893d974d16f4d936b8a92debba079cd617e1224dfafde0bc6e052ee8f7967ab","observation_id":"35a75c43-db51-430b-b713-dbad731dc6b2","resolution":{"observed_at":"2026-08-08T13:44:02.865032Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T13:44:02.869623Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2502.07138","last_updated":"2025-02-11T00:07:40Z","snapshot_observed_at":"2026-08-08T13:39:16.436016Z","submitted_at":"2025-02-11T00:07:40Z","title":"Towards a Robust Framework for Multimodal Hate Detection: A Study on Video vs. Image-based Content","version":1},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-08-08T13:44:02.869623Z"},"links":{"citing_paper":"/paper/2502.07138"},"observation_digest":"sha256:bdc7e51bf05010ed387008c05e3307a61088e0f86c96f67394f5d0786c1adf58","observation_id":"55d57eb5-8542-4dbc-a811-d73e8f9e686c","resolution":{"observed_at":"2026-08-08T13:44:02.869623Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T13:44:02.874236Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2502.07138","last_updated":"2025-02-11T00:07:40Z","snapshot_observed_at":"2026-08-08T13:39:16.436016Z","submitted_at":"2025-02-11T00:07:40Z","title":"Towards a Robust Framework for Multimodal Hate Detection: A Study on Video vs. Image-based Content","version":1},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-08-08T13:44:02.874236Z"},"links":{"citing_paper":"/paper/2502.07138"},"observation_digest":"sha256:a79472552be69b245002a030ba7436a40c585efc524498fefdb9d4f8a76adec7","observation_id":"b5efa369-25fe-475f-b0d8-a7bb13d49064","resolution":{"observed_at":"2026-08-08T13:44:02.874236Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T13:44:03.597505Z","title":null,"venue":null,"work_id":"ea7d4698-1831-4695-908f-86b10a122e63","year":2021},"citing_paper":{"arxiv_id":"2502.07138","last_updated":"2025-02-11T00:07:40Z","snapshot_observed_at":"2026-08-08T13:39:16.436016Z","submitted_at":"2025-02-11T00:07:40Z","title":"Towards a Robust Framework for Multimodal Hate Detection: A Study on Video vs. Image-based Content","version":1},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-08-08T13:44:02.879671Z"},"links":{"citing_paper":"/paper/2502.07138"},"observation_digest":"sha256:e36b51bb925ec5d79b26bf2202ff76e762bef26891299c694b3149fd9add47a8","observation_id":"17d60e01-393c-47ca-8d24-ddd627a577da","resolution":{"observed_at":"2026-08-08T13:44:03.602445Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T13:44:03.581520Z","title":null,"venue":null,"work_id":"ba6df3d1-47aa-4a26-af85-5ba7a65bc2b6","year":2021},"citing_paper":{"arxiv_id":"2502.07138","last_updated":"2025-02-11T00:07:40Z","snapshot_observed_at":"2026-08-08T13:39:16.436016Z","submitted_at":"2025-02-11T00:07:40Z","title":"Towards a Robust Framework for Multimodal Hate Detection: A Study on Video vs. Image-based Content","version":1},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-08-08T13:44:02.884167Z"},"links":{"citing_paper":"/paper/2502.07138"},"observation_digest":"sha256:13b2edc177df0056e9965d363d8c513bfc8a0acbbd6f7b346fd7a0748b17ea8f","observation_id":"a8eceed1-bde2-4e6c-a5c0-a1c5acb5a94d","resolution":{"observed_at":"2026-08-08T13:44:03.586977Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T13:44:03.566630Z","title":null,"venue":null,"work_id":"33d54b00-68e2-4ed7-abd2-f56eb29fd514","year":null},"citing_paper":{"arxiv_id":"2502.07138","last_updated":"2025-02-11T00:07:40Z","snapshot_observed_at":"2026-08-08T13:39:16.436016Z","submitted_at":"2025-02-11T00:07:40Z","title":"Towards a Robust Framework for Multimodal Hate Detection: A Study on Video vs. Image-based Content","version":1},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-08-08T13:44:02.888678Z"},"links":{"citing_paper":"/paper/2502.07138"},"observation_digest":"sha256:a4d51335c62b78ea0b61a96c95918f5a0d294fe63b5a798c04ad35cc5e90feb6","observation_id":"742a4f20-388f-4b5b-ae1f-083db6da44d6","resolution":{"observed_at":"2026-08-08T13:44:03.571228Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T13:44:02.900660Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2502.07138","last_updated":"2025-02-11T00:07:40Z","snapshot_observed_at":"2026-08-08T13:39:16.436016Z","submitted_at":"2025-02-11T00:07:40Z","title":"Towards a Robust Framework for Multimodal Hate Detection: A Study on Video vs. Image-based Content","version":1},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-08-08T13:44:02.900660Z"},"links":{"citing_paper":"/paper/2502.07138"},"observation_digest":"sha256:a2dcacf5407d222e26cf61d483aa0246fdf1ab1e11ed088230ac21d1cb0c476a","observation_id":"74a78f99-2a28-4239-b16e-5de1d36b3897","resolution":{"observed_at":"2026-08-08T13:44:02.900660Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2304.07193","last_updated":"2024-02-02T10:24:09Z","snapshot_observed_at":"2026-08-06T05:58:29.182448Z","submitted_at":"2023-04-14T15:12:19Z","title":"DINOv2: Learning Robust Visual Features without Supervision","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2304.07193","snapshot_observed_at":"2026-08-08T13:44:02.910414Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2502.07138","last_updated":"2025-02-11T00:07:40Z","snapshot_observed_at":"2026-08-08T13:39:16.436016Z","submitted_at":"2025-02-11T00:07:40Z","title":"Towards a Robust Framework for Multimodal Hate Detection: A Study on Video vs. Image-based Content","version":1},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-08-08T13:44:02.910414Z"},"links":{"cited_paper":"/paper/2304.07193","citing_paper":"/paper/2502.07138"},"observation_digest":"sha256:afcae4e5e7e3552e023d1ecb369ff43d612a12fa9bc74fcb9f84ed9f3f6392ba","observation_id":"c8dac09a-16ca-47a5-a689-024f7ae9486a","resolution":{"observed_at":"2026-08-08T13:44:02.910414Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2110.00413","last_updated":"2021-09-24T17:11:42Z","snapshot_observed_at":"2026-08-04T01:59:46.676981Z","submitted_at":"2021-09-24T17:11:42Z","title":"Detecting Harmful Memes and Their Targets","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2110.00413","snapshot_observed_at":"2026-08-08T13:44:02.915248Z","title":null,"venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2502.07138","last_updated":"2025-02-11T00:07:40Z","snapshot_observed_at":"2026-08-08T13:39:16.436016Z","submitted_at":"2025-02-11T00:07:40Z","title":"Towards a Robust Framework for Multimodal Hate Detection: A Study on Video vs. Image-based Content","version":1},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-08-08T13:44:02.915248Z"},"links":{"cited_paper":"/paper/2110.00413","citing_paper":"/paper/2502.07138"},"observation_digest":"sha256:13c68ffb8e158d9916717ca160fffe3506a9ea581ce2d7b658318ddbdd51c9d2","observation_id":"f18dcbb1-d50d-4e60-aa49-9a8b1ef45865","resolution":{"observed_at":"2026-08-08T13:44:02.915248Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2311.08110","last_updated":"2024-10-30T12:34:16Z","snapshot_observed_at":"2026-08-02T08:44:15.425923Z","submitted_at":"2023-11-14T12:14:54Z","title":"Improving Hateful Meme Detection through Retrieval-Guided Contrastive Learning","version":3},"cited_work":{"arxiv_id":"2311.08110","doi":null,"metadata_source":"pith","pith_arxiv_id":"2311.08110","snapshot_observed_at":"2026-08-08T13:44:03.304946Z","title":"Improving Hateful Meme Detection through Retrieval-Guided Contrastive Learning","venue":"cs.CL","work_id":"7d0e5efb-aeed-4460-b69c-c8652066eca6","year":2023},"citing_paper":{"arxiv_id":"2502.07138","last_updated":"2025-02-11T00:07:40Z","snapshot_observed_at":"2026-08-08T13:39:16.436016Z","submitted_at":"2025-02-11T00:07:40Z","title":"Towards a Robust Framework for Multimodal Hate Detection: A Study on Video vs. Image-based Content","version":1},"reference_index":36,"source":"pdf_text","source_observed_at":"2026-08-08T13:44:02.894742Z"},"links":{"cited_paper":"/paper/2311.08110","citing_paper":"/paper/2502.07138"},"observation_digest":"sha256:955067d8380bc9f1256175e0e589ce34154e3387fa63bfaffaec9d2e26de0be9","observation_id":"46ad1bb7-01c5-4c9a-84af-47640819ce23","resolution":{"observed_at":"2026-08-08T13:44:03.312083Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T13:44:03.531916Z","title":null,"venue":null,"work_id":"dcfe7117-b595-4f18-8416-41a50520a1ec","year":2022},"citing_paper":{"arxiv_id":"2502.07138","last_updated":"2025-02-11T00:07:40Z","snapshot_observed_at":"2026-08-08T13:39:16.436016Z","submitted_at":"2025-02-11T00:07:40Z","title":"Towards a Robust Framework for Multimodal Hate Detection: A Study on Video vs. Image-based Content","version":1},"reference_index":37,"source":"pdf_text","source_observed_at":"2026-08-08T13:44:02.924735Z"},"links":{"citing_paper":"/paper/2502.07138"},"observation_digest":"sha256:bc551a7fb32d5193010b48eb26609a4e1bab9cbfcc9f88988d278fad1b28c450","observation_id":"1c06773e-6a99-44ac-b37f-d0abbc8da2fd","resolution":{"observed_at":"2026-08-08T13:44:03.536737Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1409.1556","last_updated":"2015-04-10T16:25:04Z","snapshot_observed_at":"2026-07-06T03:53:32.549552Z","submitted_at":"2014-09-04T19:48:04Z","title":"Very Deep Convolutional Networks for Large-Scale Image Recognition","version":6},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1409.1556","snapshot_observed_at":"2026-08-08T13:44:02.929291Z","title":null,"venue":null,"work_id":null,"year":2014},"citing_paper":{"arxiv_id":"2502.07138","last_updated":"2025-02-11T00:07:40Z","snapshot_observed_at":"2026-08-08T13:39:16.436016Z","submitted_at":"2025-02-11T00:07:40Z","title":"Towards a Robust Framework for Multimodal Hate Detection: A Study on Video vs. Image-based Content","version":1},"reference_index":38,"source":"pdf_text","source_observed_at":"2026-08-08T13:44:02.929291Z"},"links":{"cited_paper":"/paper/1409.1556","citing_paper":"/paper/2502.07138"},"observation_digest":"sha256:d7b0a20b5c5d038f8c3520b65d76d4a505ea8d7d23af232df29ea15c8aa0a7c0","observation_id":"857c77f8-4e9a-45f5-80d8-f9ac9a587f70","resolution":{"observed_at":"2026-08-08T13:44:02.929291Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T13:44:03.516189Z","title":null,"venue":null,"work_id":"092b5615-de5b-44ac-a03d-dcf50ec8a8fc","year":2020},"citing_paper":{"arxiv_id":"2502.07138","last_updated":"2025-02-11T00:07:40Z","snapshot_observed_at":"2026-08-08T13:39:16.436016Z","submitted_at":"2025-02-11T00:07:40Z","title":"Towards a Robust Framework for Multimodal Hate Detection: A Study on Video vs. Image-based Content","version":1},"reference_index":39,"source":"pdf_text","source_observed_at":"2026-08-08T13:44:02.934114Z"},"links":{"citing_paper":"/paper/2502.07138"},"observation_digest":"sha256:6590b2c27a758b00b8289a705d86723a8dc4a4fa18e230dcf71751b876952413","observation_id":"a494098f-7e9d-435b-923a-f9fad10559ee","resolution":{"observed_at":"2026-08-08T13:44:03.520952Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T13:44:03.500271Z","title":null,"venue":null,"work_id":"c9df18e9-b608-4e60-a8d2-9b04bb9b8b43","year":2023},"citing_paper":{"arxiv_id":"2502.07138","last_updated":"2025-02-11T00:07:40Z","snapshot_observed_at":"2026-08-08T13:39:16.436016Z","submitted_at":"2025-02-11T00:07:40Z","title":"Towards a Robust Framework for Multimodal Hate Detection: A Study on Video vs. Image-based Content","version":1},"reference_index":40,"source":"pdf_text","source_observed_at":"2026-08-08T13:44:02.938870Z"},"links":{"citing_paper":"/paper/2502.07138"},"observation_digest":"sha256:62d9d58b28c8f0abfa4e2562a1f997c352dbd0e33949b5ee309c95c3fcaa99ef","observation_id":"b9eb9150-54b9-40f2-ab9d-bcbf7315aa23","resolution":{"observed_at":"2026-08-08T13:44:03.505240Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T13:44:02.919925Z","title":null,"venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2502.07138","last_updated":"2025-02-11T00:07:40Z","snapshot_observed_at":"2026-08-08T13:39:16.436016Z","submitted_at":"2025-02-11T00:07:40Z","title":"Towards a Robust Framework for Multimodal Hate Detection: A Study on Video vs. Image-based Content","version":1},"reference_index":41,"source":"pdf_text","source_observed_at":"2026-08-08T13:44:02.919925Z"},"links":{"citing_paper":"/paper/2502.07138"},"observation_digest":"sha256:b0c47467ff094c4727bb3e8e2943c10de5a0f661e2929dd9b8c1d15568d60917","observation_id":"a3386ba7-c049-4eb0-a56a-b4c7e400b91f","resolution":{"observed_at":"2026-08-08T13:44:02.919925Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T13:44:02.948156Z","title":null,"venue":null,"work_id":null,"year":2016},"citing_paper":{"arxiv_id":"2502.07138","last_updated":"2025-02-11T00:07:40Z","snapshot_observed_at":"2026-08-08T13:39:16.436016Z","submitted_at":"2025-02-11T00:07:40Z","title":"Towards a Robust Framework for Multimodal Hate Detection: A Study on Video vs. Image-based Content","version":1},"reference_index":42,"source":"pdf_text","source_observed_at":"2026-08-08T13:44:02.948156Z"},"links":{"citing_paper":"/paper/2502.07138"},"observation_digest":"sha256:188453f0a8821431bf588536a5da2ab9a98c14a360735be780d5b8caf1e552c4","observation_id":"c53ecdb6-8c9a-40e1-b8c3-98d1c44c8f54","resolution":{"observed_at":"2026-08-08T13:44:02.948156Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T13:44:02.952642Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2502.07138","last_updated":"2025-02-11T00:07:40Z","snapshot_observed_at":"2026-08-08T13:39:16.436016Z","submitted_at":"2025-02-11T00:07:40Z","title":"Towards a Robust Framework for Multimodal Hate Detection: A Study on Video vs. Image-based Content","version":1},"reference_index":43,"source":"pdf_text","source_observed_at":"2026-08-08T13:44:02.952642Z"},"links":{"citing_paper":"/paper/2502.07138"},"observation_digest":"sha256:e3f5e1a376119d84776aca03bd47e4cdc27c79913be464f6cfb433326d4c2297","observation_id":"3b7d05b8-8778-44af-904c-ab68a6acf8e5","resolution":{"observed_at":"2026-08-08T13:44:02.952642Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T13:44:03.465651Z","title":"the the the the the the the the the the","venue":null,"work_id":"bf4ddc8a-44f4-43b9-a9ba-49561d15708b","year":2018},"citing_paper":{"arxiv_id":"2502.07138","last_updated":"2025-02-11T00:07:40Z","snapshot_observed_at":"2026-08-08T13:39:16.436016Z","submitted_at":"2025-02-11T00:07:40Z","title":"Towards a Robust Framework for Multimodal Hate Detection: A Study on Video vs. Image-based Content","version":1},"reference_index":44,"source":"pdf_text","source_observed_at":"2026-08-08T13:44:02.957029Z"},"links":{"citing_paper":"/paper/2502.07138"},"observation_digest":"sha256:43d2fa472748a777a9d176af6ecf6de240c3d69c2854617de00aaba0e6a946c6","observation_id":"985f46f7-8917-4986-9803-f532e280d000","resolution":{"observed_at":"2026-08-08T13:44:03.470410Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T13:44:02.943466Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2502.07138","last_updated":"2025-02-11T00:07:40Z","snapshot_observed_at":"2026-08-08T13:39:16.436016Z","submitted_at":"2025-02-11T00:07:40Z","title":"Towards a Robust Framework for Multimodal Hate Detection: A Study on Video vs. Image-based Content","version":1},"reference_index":46,"source":"pdf_text","source_observed_at":"2026-08-08T13:44:02.943466Z"},"links":{"citing_paper":"/paper/2502.07138"},"observation_digest":"sha256:fd2bdef7f1876c4844eb4c98f83d097de39582c94286b91d529c01a896797ae7","observation_id":"28d7c9e1-184c-4929-828a-8ca377c0b5fb","resolution":{"observed_at":"2026-08-08T13:44:02.943466Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1809.04444","last_updated":"2018-09-12T13:51:02Z","snapshot_observed_at":"2026-07-06T07:00:48.332422Z","submitted_at":"2018-09-12T13:51:02Z","title":"Hate Speech Dataset from a White Supremacy Forum","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1809.04444","snapshot_observed_at":"2026-08-08T13:44:02.796547Z","title":"arXiv preprint arXiv:1809.04444 (2018)","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2502.07138","last_updated":"2025-02-11T00:07:40Z","snapshot_observed_at":"2026-08-08T13:39:16.436016Z","submitted_at":"2025-02-11T00:07:40Z","title":"Towards a Robust Framework for Multimodal Hate Detection: A Study on Video vs. Image-based Content","version":1},"reference_index":2018,"source":"pdf_text","source_observed_at":"2026-08-08T13:44:02.796547Z"},"links":{"cited_paper":"/paper/1809.04444","citing_paper":"/paper/2502.07138"},"observation_digest":"sha256:f5ff5f7e524badfc3b29506a1f44e2a732107ece87f7d26d9493be209ecc02f6","observation_id":"6498cd9c-a8e4-4923-b78f-b6e6978744e6","resolution":{"observed_at":"2026-08-08T13:44:02.796547Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2006.08328","last_updated":"2021-07-06T07:25:14Z","snapshot_observed_at":"2026-08-07T19:06:22.193359Z","submitted_at":"2020-06-11T08:59:57Z","title":"ETHOS: an Online Hate Speech Detection Dataset","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2006.08328","snapshot_observed_at":"2026-08-08T13:44:02.905516Z","title":"arXiv preprint arXiv:2006.08328 (2020)","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2502.07138","last_updated":"2025-02-11T00:07:40Z","snapshot_observed_at":"2026-08-08T13:39:16.436016Z","submitted_at":"2025-02-11T00:07:40Z","title":"Towards a Robust Framework for Multimodal Hate Detection: A Study on Video vs. Image-based Content","version":1},"reference_index":2020,"source":"pdf_text","source_observed_at":"2026-08-08T13:44:02.905516Z"},"links":{"cited_paper":"/paper/2006.08328","citing_paper":"/paper/2502.07138"},"observation_digest":"sha256:12c1ae29b96636cc7cea1df387d9e01d57bc5e83c5e4085541be1f31be51392d","observation_id":"c431b876-7094-409d-b354-247574bd9af5","resolution":{"observed_at":"2026-08-08T13:44:02.905516Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T13:44:02.557611Z","title":"Advances in neural information processing systems 35 (2022), 23716–23736","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2502.07138","last_updated":"2025-02-11T00:07:40Z","snapshot_observed_at":"2026-08-08T13:39:16.436016Z","submitted_at":"2025-02-11T00:07:40Z","title":"Towards a Robust Framework for Multimodal Hate Detection: A Study on Video vs. Image-based Content","version":1},"reference_index":2022,"source":"pdf_text","source_observed_at":"2026-08-08T13:44:02.557611Z"},"links":{"citing_paper":"/paper/2502.07138"},"observation_digest":"sha256:54fedc0780762b86d18c8c61de3c70f0a276c295fd1505e63fb6b372a2654ab6","observation_id":"34f60b51-ab11-4302-a4cf-2979cd6369c0","resolution":{"observed_at":"2026-08-08T13:44:02.557611Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T13:44:02.815961Z","title":"InICASSP 2023-2023 IEEE International Conference on Acoustics, Speech and Signal Processing (ICASSP)","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2502.07138","last_updated":"2025-02-11T00:07:40Z","snapshot_observed_at":"2026-08-08T13:39:16.436016Z","submitted_at":"2025-02-11T00:07:40Z","title":"Towards a Robust Framework for Multimodal Hate Detection: A Study on Video vs. Image-based Content","version":1},"reference_index":2023,"source":"pdf_text","source_observed_at":"2026-08-08T13:44:02.815961Z"},"links":{"citing_paper":"/paper/2502.07138"},"observation_digest":"sha256:d3e8e5d4293d52d4e0c1ea6eeb49a32d15d8a2efe450c2c883e5e99450862fb6","observation_id":"f88d2004-96f0-4d37-b8fa-67ac600ccedd","resolution":{"observed_at":"2026-08-08T13:44:02.815961Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"paper":{"arxiv_id":"2502.07138","last_updated":"2025-02-11T00:07:40Z","latest_version":1,"primary_category":"cs.CV","snapshot_observed_at":"2026-08-08T13:39:16.436016Z","submitted_at":"2025-02-11T00:07:40Z","title":"Towards a Robust Framework for Multimodal Hate Detection: A Study on Video vs. Image-based Content"},"reference_resolution":{"displayed":49,"state_counts":{"malformed_identifier":0,"metadata_mismatch":1,"parse_uncertain":0,"unresolved":46,"verified_exact":1,"verified_fuzzy":1},"total_outbound_references":49},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"thesis":"As of 9 August 2026, this Paper Citation Record lists 49 of 49 outbound references and 0 inbound Pith citation observations for arXiv:2502.07138."}