{"as_of":"2026-08-15T13:19:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:a933396752bbd778e05af0563a317cd2a8f7a1860950606103d7c6ebf4d0e71d","coverage":[{"denominator":35,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":35,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-11T10:37:19.977230Z","state":"measured"},{"denominator":35,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":35,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-15T06:32:42.880941+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2412.16446/citation-record","integrity":"/paper/2412.16446/integrity","json":"/paper/2412.16446/citation-record.json","paper":"/paper/2412.16446"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T10:37:20.585696Z","title":"Findings from WeProtect global alliance/ technology coalition survey of technology companies","venue":null,"work_id":"8333e116-ab85-4558-91e5-85b1a81f1a63","year":null},"citing_paper":{"arxiv_id":"2412.16446","last_updated":"2024-12-21T02:34:24Z","snapshot_observed_at":"2026-08-13T14:59:50.836460Z","submitted_at":"2024-12-21T02:34:24Z","title":"Sensitive Image Classification by Vision Transformers","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-11T10:37:19.824734Z"},"links":{"citing_paper":"/paper/2412.16446"},"observation_digest":"sha256:354e42f908a0b8b338f822077ff4e7202d9e32da3a79d187e7f9966a87c1231e","observation_id":"a3247c8f-959b-49a7-8e3b-b584f6c791e6","resolution":{"observed_at":"2026-08-11T10:37:20.590035Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T10:37:20.571820Z","title":"The tale of Telegram governance: When the rule of thumb fails,","venue":null,"work_id":"038b4b50-fc84-4426-ae7d-0c3ba6341ba3","year":2021},"citing_paper":{"arxiv_id":"2412.16446","last_updated":"2024-12-21T02:34:24Z","snapshot_observed_at":"2026-08-13T14:59:50.836460Z","submitted_at":"2024-12-21T02:34:24Z","title":"Sensitive Image Classification by Vision Transformers","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-11T10:37:19.829751Z"},"links":{"citing_paper":"/paper/2412.16446"},"observation_digest":"sha256:52458a323c9d73ce1af41b1fc5a8d8443d8024caee043824473556f5bf2d7f00","observation_id":"93612713-5a75-499e-9b9c-f6c04ed05ba9","resolution":{"observed_at":"2026-08-11T10:37:20.576665Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T10:37:20.558365Z","title":"Detecting child sexual abuse material: A comprehensive survey,","venue":null,"work_id":"1df57b14-a09d-483c-9a70-6207b96ec0d7","year":2020},"citing_paper":{"arxiv_id":"2412.16446","last_updated":"2024-12-21T02:34:24Z","snapshot_observed_at":"2026-08-13T14:59:50.836460Z","submitted_at":"2024-12-21T02:34:24Z","title":"Sensitive Image Classification by Vision Transformers","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-11T10:37:19.834465Z"},"links":{"citing_paper":"/paper/2412.16446"},"observation_digest":"sha256:92cff0df4e7e08dcd4526810ec93864d7e7885956189ae6127b93f7afc4adfe8","observation_id":"3d139b80-6b47-4932-a132-105c0127f3f6","resolution":{"observed_at":"2026-08-11T10:37:20.562766Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T10:37:20.542881Z","title":"Smart content recognition from images using a mixture of convolutional neural networks,","venue":null,"work_id":"ad153fd0-684b-4583-93e0-6e850a8cbd17","year":2017},"citing_paper":{"arxiv_id":"2412.16446","last_updated":"2024-12-21T02:34:24Z","snapshot_observed_at":"2026-08-13T14:59:50.836460Z","submitted_at":"2024-12-21T02:34:24Z","title":"Sensitive Image Classification by Vision Transformers","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-11T10:37:19.839109Z"},"links":{"citing_paper":"/paper/2412.16446"},"observation_digest":"sha256:aaea72876a869e548dd217f51701d0286cdb1b83f70c3154ce392dd6a69e5a92","observation_id":"dedefd7a-479c-4c57-abae-50b524c24806","resolution":{"observed_at":"2026-08-11T10:37:20.548476Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"dataset/1345648","doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T10:37:20.173025Z","title":"20k nudity dataset,","venue":null,"work_id":"9d192341-df86-41f8-8146-b8052d611e1c","year":2020},"citing_paper":{"arxiv_id":"2412.16446","last_updated":"2024-12-21T02:34:24Z","snapshot_observed_at":"2026-08-13T14:59:50.836460Z","submitted_at":"2024-12-21T02:34:24Z","title":"Sensitive Image Classification by Vision Transformers","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-11T10:37:19.843632Z"},"links":{"citing_paper":"/paper/2412.16446"},"observation_digest":"sha256:890bc81c8b77b53a27686ffa1c83f06c285de633f7e61b30b38284aa598389a2","observation_id":"07ebffce-6460-4b8a-a787-f4e18e7ebd20","resolution":{"observed_at":"2026-08-11T10:37:20.180497Z","resolver_source":"raw_fallback","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T10:37:20.528983Z","title":"AttM- CNN: Attention and metric learning based CNN for pornography, age and child sexual abuse (CSA) detection in images,","venue":null,"work_id":"7cacc3c8-a570-4383-b9cf-d3c31967b1dc","year":2021},"citing_paper":{"arxiv_id":"2412.16446","last_updated":"2024-12-21T02:34:24Z","snapshot_observed_at":"2026-08-13T14:59:50.836460Z","submitted_at":"2024-12-21T02:34:24Z","title":"Sensitive Image Classification by Vision Transformers","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-11T10:37:19.848013Z"},"links":{"citing_paper":"/paper/2412.16446"},"observation_digest":"sha256:12bc3ec0478de19e5bb2a858dc09c40c7c321cc3d8a06fe4cbb3c37c52b3d058","observation_id":"1e6a80df-73c7-4ad2-85c9-5c17aec191f8","resolution":{"observed_at":"2026-08-11T10:37:20.533728Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T10:37:20.513978Z","title":"Description of the neural network based on AB/DL pictures. Possible implications for forensic sexology,","venue":null,"work_id":"21225220-a299-47ef-9cc6-799930c7da55","year":2022},"citing_paper":{"arxiv_id":"2412.16446","last_updated":"2024-12-21T02:34:24Z","snapshot_observed_at":"2026-08-13T14:59:50.836460Z","submitted_at":"2024-12-21T02:34:24Z","title":"Sensitive Image Classification by Vision Transformers","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-11T10:37:19.852580Z"},"links":{"citing_paper":"/paper/2412.16446"},"observation_digest":"sha256:94374bfbf5afc81336a321c213c727c6b88960e3ac1f1b034715c7d316004db6","observation_id":"e823b342-7dda-4768-a42f-4d5fb91e7bcd","resolution":{"observed_at":"2026-08-11T10:37:20.519350Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T10:37:20.498263Z","title":"LSPD: A large-scale pornographic dataset for detection and classification,","venue":null,"work_id":"e8407b7f-67be-4c32-8fae-123bbb15071d","year":2022},"citing_paper":{"arxiv_id":"2412.16446","last_updated":"2024-12-21T02:34:24Z","snapshot_observed_at":"2026-08-13T14:59:50.836460Z","submitted_at":"2024-12-21T02:34:24Z","title":"Sensitive Image Classification by Vision Transformers","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-11T10:37:19.857381Z"},"links":{"citing_paper":"/paper/2412.16446"},"observation_digest":"sha256:ba652960a7249f2d1a251b31a3740fc02ac07b872cd2ba674f1051a71e53e5dd","observation_id":"725679e3-c2f1-4203-ac36-cf55d46cd546","resolution":{"observed_at":"2026-08-11T10:37:20.503920Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T10:37:20.482135Z","title":null,"venue":null,"work_id":"09eef013-2f76-47d9-a00b-1a9b39e87491","year":null},"citing_paper":{"arxiv_id":"2412.16446","last_updated":"2024-12-21T02:34:24Z","snapshot_observed_at":"2026-08-13T14:59:50.836460Z","submitted_at":"2024-12-21T02:34:24Z","title":"Sensitive Image Classification by Vision Transformers","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-11T10:37:19.861365Z"},"links":{"citing_paper":"/paper/2412.16446"},"observation_digest":"sha256:7d00d718832d5ba3ce54eea2447bbf8f9fb8c80ec877881f16065bf21fe8460e","observation_id":"b0e23209-dd61-431b-81cf-380d73dd6919","resolution":{"observed_at":"2026-08-11T10:37:20.487588Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T10:37:20.467644Z","title":"Detecting pornographic images by localizing skin rois,","venue":null,"work_id":"079cd5f8-ccdf-44f6-ba0f-6e9f1e4a7f35","year":2013},"citing_paper":{"arxiv_id":"2412.16446","last_updated":"2024-12-21T02:34:24Z","snapshot_observed_at":"2026-08-13T14:59:50.836460Z","submitted_at":"2024-12-21T02:34:24Z","title":"Sensitive Image Classification by Vision Transformers","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-11T10:37:19.865681Z"},"links":{"citing_paper":"/paper/2412.16446"},"observation_digest":"sha256:9e45a250ec7b22d242163af8ac7bf7d298654470ae1afcba6c907958a69a4fc4","observation_id":"275d7f96-4e65-4209-adeb-05c41a44f927","resolution":{"observed_at":"2026-08-11T10:37:20.472012Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T10:37:20.452491Z","title":"NuDetective: A Forensic Tool to Help Combat Child Pornography through Automatic Nudity Detection,","venue":null,"work_id":"03dde329-7212-4ea7-a6ab-85627a0855a5","year":2010},"citing_paper":{"arxiv_id":"2412.16446","last_updated":"2024-12-21T02:34:24Z","snapshot_observed_at":"2026-08-13T14:59:50.836460Z","submitted_at":"2024-12-21T02:34:24Z","title":"Sensitive Image Classification by Vision Transformers","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-11T10:37:19.869443Z"},"links":{"citing_paper":"/paper/2412.16446"},"observation_digest":"sha256:8c4f1f014f7adcf4f912f6ceb7696571c379fee55dbd06ace3bda866c106d25c","observation_id":"fee19391-3a80-4351-8615-e122190b463f","resolution":{"observed_at":"2026-08-11T10:37:20.456656Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T10:37:20.439243Z","title":"Open nsfw model,","venue":null,"work_id":"ccae2543-7b6e-43f7-87d6-b5d4c483a75a","year":2023},"citing_paper":{"arxiv_id":"2412.16446","last_updated":"2024-12-21T02:34:24Z","snapshot_observed_at":"2026-08-13T14:59:50.836460Z","submitted_at":"2024-12-21T02:34:24Z","title":"Sensitive Image Classification by Vision Transformers","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-11T10:37:19.873444Z"},"links":{"citing_paper":"/paper/2412.16446"},"observation_digest":"sha256:dfd29f59582b35d82eb2982b22a2f03f4fb3914f567e4815587bc618b7a6d9a4","observation_id":"061454a2-7421-44bd-a022-7fcacb5e3c8e","resolution":{"observed_at":"2026-08-11T10:37:20.443407Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T10:37:20.423991Z","title":"Laying foundations for effective machine learning in law enforce- ment. Majura – A labelling schema for child exploitation materials,","venue":null,"work_id":"8a8fef91-8817-4a5c-a76a-1a0436ecee72","year":2018},"citing_paper":{"arxiv_id":"2412.16446","last_updated":"2024-12-21T02:34:24Z","snapshot_observed_at":"2026-08-13T14:59:50.836460Z","submitted_at":"2024-12-21T02:34:24Z","title":"Sensitive Image Classification by Vision Transformers","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-11T10:37:19.877368Z"},"links":{"citing_paper":"/paper/2412.16446"},"observation_digest":"sha256:36a6ace7f0b22837a9e12002edffe354d7ba5d58a9241b29d0b7822215bec65f","observation_id":"d5f4db3f-303e-4547-b344-a0b95be9bf8c","resolution":{"observed_at":"2026-08-11T10:37:20.429531Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1409.0473","last_updated":"2016-05-19T21:53:22Z","snapshot_observed_at":"2026-08-12T12:07:33.202888Z","submitted_at":"2014-09-01T16:33:02Z","title":"Neural Machine Translation by Jointly Learning to Align and Translate","version":7},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1409.0473","snapshot_observed_at":"2026-08-11T10:37:19.881081Z","title":"Neural machine trans- lation by jointly learning to align and translate,","venue":null,"work_id":null,"year":2014},"citing_paper":{"arxiv_id":"2412.16446","last_updated":"2024-12-21T02:34:24Z","snapshot_observed_at":"2026-08-13T14:59:50.836460Z","submitted_at":"2024-12-21T02:34:24Z","title":"Sensitive Image Classification by Vision Transformers","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-11T10:37:19.881081Z"},"links":{"cited_paper":"/paper/1409.0473","citing_paper":"/paper/2412.16446"},"observation_digest":"sha256:c885155ebefbba1326ee6993379239acf21d157929a36def52e9bd50f9989fa3","observation_id":"2738a141-98ee-4173-aad6-281e53a34d06","resolution":{"observed_at":"2026-08-11T10:37:19.881081Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1601.06823","last_updated":"2016-01-25T21:54:02Z","snapshot_observed_at":"2026-08-14T22:13:09.012085Z","submitted_at":"2016-01-25T21:54:02Z","title":"Survey on the attention based RNN model and its applications in computer vision","version":1},"cited_work":{"arxiv_id":"1601.06823","doi":null,"metadata_source":"pith","pith_arxiv_id":"1601.06823","snapshot_observed_at":"2026-08-11T10:37:20.080659Z","title":"Survey on the attention based RNN model and its applications in computer vision","venue":"cs.CV","work_id":"23424704-e26a-440f-8ffa-c39638021345","year":2016},"citing_paper":{"arxiv_id":"2412.16446","last_updated":"2024-12-21T02:34:24Z","snapshot_observed_at":"2026-08-13T14:59:50.836460Z","submitted_at":"2024-12-21T02:34:24Z","title":"Sensitive Image Classification by Vision Transformers","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-11T10:37:19.885023Z"},"links":{"cited_paper":"/paper/1601.06823","citing_paper":"/paper/2412.16446"},"observation_digest":"sha256:60e2e69feed8444b5ec487dbe6a33bd7e213db52fdd4416326595db1caaccee8","observation_id":"ca7ea071-2fa1-4600-ac11-9a01e9b04636","resolution":{"observed_at":"2026-08-11T10:37:20.088055Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1705.06950","last_updated":"2017-05-19T12:07:01Z","snapshot_observed_at":"2026-08-15T11:35:18.832923Z","submitted_at":"2017-05-19T12:07:01Z","title":"The Kinetics Human Action Video Dataset","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1705.06950","snapshot_observed_at":"2026-08-11T10:37:19.888909Z","title":"The kinetics human action video dataset,","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2412.16446","last_updated":"2024-12-21T02:34:24Z","snapshot_observed_at":"2026-08-13T14:59:50.836460Z","submitted_at":"2024-12-21T02:34:24Z","title":"Sensitive Image Classification by Vision Transformers","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-11T10:37:19.888909Z"},"links":{"cited_paper":"/paper/1705.06950","citing_paper":"/paper/2412.16446"},"observation_digest":"sha256:3dc018059a2cb9f6babdad26f6c6817ba7b2443b7de24804a3dd1180e45d3e0b","observation_id":"5db4cb8a-494b-46fc-ad12-514e57ff39f4","resolution":{"observed_at":"2026-08-11T10:37:19.888909Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T10:37:20.409290Z","title":"The “something something","venue":null,"work_id":"7a88ad9a-d956-45cf-96b7-d2dda9ab6330","year":2017},"citing_paper":{"arxiv_id":"2412.16446","last_updated":"2024-12-21T02:34:24Z","snapshot_observed_at":"2026-08-13T14:59:50.836460Z","submitted_at":"2024-12-21T02:34:24Z","title":"Sensitive Image Classification by Vision Transformers","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-11T10:37:19.893297Z"},"links":{"citing_paper":"/paper/2412.16446"},"observation_digest":"sha256:332edfb800bde194a7f8165202e12c05aab4cd130f2030f77ffb45824c3058ba","observation_id":"755b89b8-1194-42f0-b51e-774c19727d60","resolution":{"observed_at":"2026-08-11T10:37:20.413802Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T10:37:19.897311Z","title":"Multimodal learning with trans- formers: A survey,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2412.16446","last_updated":"2024-12-21T02:34:24Z","snapshot_observed_at":"2026-08-13T14:59:50.836460Z","submitted_at":"2024-12-21T02:34:24Z","title":"Sensitive Image Classification by Vision Transformers","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-11T10:37:19.897311Z"},"links":{"citing_paper":"/paper/2412.16446"},"observation_digest":"sha256:40769ec059b1ea09a457ecf7e1d99a8ffa969e6249ba9acc04ab4014ca8ca98d","observation_id":"6477ee2c-bc56-4763-92a7-6c1aa4fca996","resolution":{"observed_at":"2026-08-11T10:37:19.897311Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T10:37:20.384156Z","title":"Frozen CLIP models are efficient video learners,","venue":null,"work_id":"cc171823-5227-4f7d-9a67-cd9154538d29","year":2022},"citing_paper":{"arxiv_id":"2412.16446","last_updated":"2024-12-21T02:34:24Z","snapshot_observed_at":"2026-08-13T14:59:50.836460Z","submitted_at":"2024-12-21T02:34:24Z","title":"Sensitive Image Classification by Vision Transformers","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-11T10:37:19.901198Z"},"links":{"citing_paper":"/paper/2412.16446"},"observation_digest":"sha256:aa83670fd0087a4207ef2452438d975d50e90d86dc3497873d4974332eb33405","observation_id":"b75aecde-cf7e-4111-be61-bfa67dfaf42d","resolution":{"observed_at":"2026-08-11T10:37:20.388758Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T10:37:20.369759Z","title":"VideoMAE: Masked autoencoders are data-efficient learners for self-supervised video pre- training,","venue":null,"work_id":"6f206b1c-cda1-4489-96aa-3964faadc588","year":2022},"citing_paper":{"arxiv_id":"2412.16446","last_updated":"2024-12-21T02:34:24Z","snapshot_observed_at":"2026-08-13T14:59:50.836460Z","submitted_at":"2024-12-21T02:34:24Z","title":"Sensitive Image Classification by Vision Transformers","version":1},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-11T10:37:19.905164Z"},"links":{"citing_paper":"/paper/2412.16446"},"observation_digest":"sha256:1a396840029c5d64433affe948a4fd6bf74010255c33e1e27f4f95e71c2d99f2","observation_id":"bf12f670-a356-47c9-bd56-039b168bb1f6","resolution":{"observed_at":"2026-08-11T10:37:20.374744Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2102.05095","last_updated":"2021-06-09T14:48:13Z","snapshot_observed_at":"2026-08-13T20:17:16.277117Z","submitted_at":"2021-02-09T19:49:33Z","title":"Is Space-Time Attention All You Need for Video Understanding?","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2102.05095","snapshot_observed_at":"2026-08-11T10:37:19.909396Z","title":"Is space-time attention all you need for video understanding?","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2412.16446","last_updated":"2024-12-21T02:34:24Z","snapshot_observed_at":"2026-08-13T14:59:50.836460Z","submitted_at":"2024-12-21T02:34:24Z","title":"Sensitive Image Classification by Vision Transformers","version":1},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-11T10:37:19.909396Z"},"links":{"cited_paper":"/paper/2102.05095","citing_paper":"/paper/2412.16446"},"observation_digest":"sha256:9db74451b8dcbc4ae0ff7d462a01c451943f3d8dc3a7b7cec42426f2f30d5eff","observation_id":"d766ce6d-4c5f-40be-8d5d-1431e86b02eb","resolution":{"observed_at":"2026-08-11T10:37:19.909396Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2111.12993","last_updated":"2021-11-25T10:01:05Z","snapshot_observed_at":"2026-07-06T12:12:06.958305Z","submitted_at":"2021-11-25T10:01:05Z","title":"PolyViT: Co-training Vision Transformers on Images, Videos and Audio","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2111.12993","snapshot_observed_at":"2026-08-11T10:37:19.914676Z","title":"PolyViT: Co-training vision transform- ers on images, videos and audio,","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2412.16446","last_updated":"2024-12-21T02:34:24Z","snapshot_observed_at":"2026-08-13T14:59:50.836460Z","submitted_at":"2024-12-21T02:34:24Z","title":"Sensitive Image Classification by Vision Transformers","version":1},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-11T10:37:19.914676Z"},"links":{"cited_paper":"/paper/2111.12993","citing_paper":"/paper/2412.16446"},"observation_digest":"sha256:5b6ac611d905a46a6fbcca10d58288a77a1f80d5da7bf560fa81eb2b6bd83a89","observation_id":"54c9698f-6890-46eb-becd-a9439c9e4701","resolution":{"observed_at":"2026-08-11T10:37:19.914676Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T10:37:20.353427Z","title":"Omnimae: Single model masked pretraining on images and videos,","venue":null,"work_id":"d89d2c86-7690-4608-84b9-967a5cb10fe2","year":2023},"citing_paper":{"arxiv_id":"2412.16446","last_updated":"2024-12-21T02:34:24Z","snapshot_observed_at":"2026-08-13T14:59:50.836460Z","submitted_at":"2024-12-21T02:34:24Z","title":"Sensitive Image Classification by Vision Transformers","version":1},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-11T10:37:19.919303Z"},"links":{"citing_paper":"/paper/2412.16446"},"observation_digest":"sha256:79f85fbe02ad7facaa6f114ad59c89a6c0e055666e82116e2eac475f1e14ddf0","observation_id":"d1c46bea-02dc-4088-a560-d39b6b25ea66","resolution":{"observed_at":"2026-08-11T10:37:20.359371Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T10:37:20.336806Z","title":"Omnivore: A single model for many visual modalities,","venue":null,"work_id":"cc9461ef-0a7b-4a29-ab5b-49d9fa00ade0","year":2022},"citing_paper":{"arxiv_id":"2412.16446","last_updated":"2024-12-21T02:34:24Z","snapshot_observed_at":"2026-08-13T14:59:50.836460Z","submitted_at":"2024-12-21T02:34:24Z","title":"Sensitive Image Classification by Vision Transformers","version":1},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-11T10:37:19.923664Z"},"links":{"citing_paper":"/paper/2412.16446"},"observation_digest":"sha256:9470e8ec8c9e4fb75bf1431a2265455f4091cd5891c37b335c4287ef9b509c28","observation_id":"ca03eb9b-1a15-4b0a-a9dc-4fe64b80c01b","resolution":{"observed_at":"2026-08-11T10:37:20.342848Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2206.09852","last_updated":"2022-06-20T15:31:13Z","snapshot_observed_at":"2026-08-15T09:54:13.666986Z","submitted_at":"2022-06-20T15:31:13Z","title":"M&M Mix: A Multimodal Multiview Transformer Ensemble","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2206.09852","snapshot_observed_at":"2026-08-11T10:37:19.928139Z","title":"M&M mix: A multimodal multiview transformer ensemble,","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2412.16446","last_updated":"2024-12-21T02:34:24Z","snapshot_observed_at":"2026-08-13T14:59:50.836460Z","submitted_at":"2024-12-21T02:34:24Z","title":"Sensitive Image Classification by Vision Transformers","version":1},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-08-11T10:37:19.928139Z"},"links":{"cited_paper":"/paper/2206.09852","citing_paper":"/paper/2412.16446"},"observation_digest":"sha256:7dc44c3ba4d84e79e71e653f942e008ae54901a68e8ca18dc5868004271588da","observation_id":"aa71f67d-3c31-43f1-8f6d-432f80907d63","resolution":{"observed_at":"2026-08-11T10:37:19.928139Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T10:37:20.319569Z","title":"MultiMAE: Multi-modal multi-task masked autoencoders,","venue":null,"work_id":"ebb1851b-f978-4ebf-bf8c-a2aa05f86473","year":2022},"citing_paper":{"arxiv_id":"2412.16446","last_updated":"2024-12-21T02:34:24Z","snapshot_observed_at":"2026-08-13T14:59:50.836460Z","submitted_at":"2024-12-21T02:34:24Z","title":"Sensitive Image Classification by Vision Transformers","version":1},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-08-11T10:37:19.933264Z"},"links":{"citing_paper":"/paper/2412.16446"},"observation_digest":"sha256:554487c5d96d95be81daf71bb1b3edeaef5ec4e99d5274a0633d518e191c168c","observation_id":"5aaa08d9-12da-44e2-9225-2e1a0f4b434e","resolution":{"observed_at":"2026-08-11T10:37:20.325566Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T10:37:19.937968Z","title":"Video swin transformer,","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2412.16446","last_updated":"2024-12-21T02:34:24Z","snapshot_observed_at":"2026-08-13T14:59:50.836460Z","submitted_at":"2024-12-21T02:34:24Z","title":"Sensitive Image Classification by Vision Transformers","version":1},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-08-11T10:37:19.937968Z"},"links":{"citing_paper":"/paper/2412.16446"},"observation_digest":"sha256:96ba247a69da7eb75af67c70dc25537ef594471737e90a8cd9cbe238661a245c","observation_id":"790da5fd-1fa7-4c0d-be08-ddd584149612","resolution":{"observed_at":"2026-08-11T10:37:19.937968Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T10:37:20.292514Z","title":"BEVT: BERT pretraining of video transform- ers,","venue":null,"work_id":"f8df130f-826b-432b-a115-3181acb7c648","year":2022},"citing_paper":{"arxiv_id":"2412.16446","last_updated":"2024-12-21T02:34:24Z","snapshot_observed_at":"2026-08-13T14:59:50.836460Z","submitted_at":"2024-12-21T02:34:24Z","title":"Sensitive Image Classification by Vision Transformers","version":1},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-08-11T10:37:19.942883Z"},"links":{"citing_paper":"/paper/2412.16446"},"observation_digest":"sha256:c9ac457e666c9dc0f1ac3d3f0b7bd5263777eaf0b83ef29b2c7d9f589d38d8f3","observation_id":"dbf9293b-db3f-483b-98cd-4e59398db252","resolution":{"observed_at":"2026-08-11T10:37:20.298900Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T10:37:20.275734Z","title":"Attention is all you need,","venue":null,"work_id":"210f69cc-a6af-4b28-aaf4-ba9d6619987e","year":2017},"citing_paper":{"arxiv_id":"2412.16446","last_updated":"2024-12-21T02:34:24Z","snapshot_observed_at":"2026-08-13T14:59:50.836460Z","submitted_at":"2024-12-21T02:34:24Z","title":"Sensitive Image Classification by Vision Transformers","version":1},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-08-11T10:37:19.947832Z"},"links":{"citing_paper":"/paper/2412.16446"},"observation_digest":"sha256:3877d8a8db2624996774406d6d866cfb911c026eed74a5aab5e6d1fdf1d70e12","observation_id":"41d996c0-5fb5-4e87-a7a6-47f6a52e68c2","resolution":{"observed_at":"2026-08-11T10:37:20.281089Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T10:37:19.953563Z","title":"An image is worth 16x16 words: Transformers for image recognition at scale,","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2412.16446","last_updated":"2024-12-21T02:34:24Z","snapshot_observed_at":"2026-08-13T14:59:50.836460Z","submitted_at":"2024-12-21T02:34:24Z","title":"Sensitive Image Classification by Vision Transformers","version":1},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-08-11T10:37:19.953563Z"},"links":{"citing_paper":"/paper/2412.16446"},"observation_digest":"sha256:c69f27e4f2ba539866339d619c47db7dfb0a4409c87ec313f0a0407b9787683c","observation_id":"bfac9bde-7f4b-49ab-866a-e3c508af8b25","resolution":{"observed_at":"2026-08-11T10:37:19.953563Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T10:37:19.958117Z","title":"Swin transformer: Hierarchical vision transformer using shifted windows,","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2412.16446","last_updated":"2024-12-21T02:34:24Z","snapshot_observed_at":"2026-08-13T14:59:50.836460Z","submitted_at":"2024-12-21T02:34:24Z","title":"Sensitive Image Classification by Vision Transformers","version":1},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-08-11T10:37:19.958117Z"},"links":{"citing_paper":"/paper/2412.16446"},"observation_digest":"sha256:708b443bf96d126702ebcdf5c1ed746a35a860e1dd9f610c4bb4fd193da50513","observation_id":"5c48f9d8-efd4-4a6b-948e-a2e6adefd456","resolution":{"observed_at":"2026-08-11T10:37:19.958117Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T10:37:20.237774Z","title":"Fast vision transformers with HiLo at- tention,","venue":null,"work_id":"4a2b672d-f25b-49fc-9688-2f17a5c79912","year":2022},"citing_paper":{"arxiv_id":"2412.16446","last_updated":"2024-12-21T02:34:24Z","snapshot_observed_at":"2026-08-13T14:59:50.836460Z","submitted_at":"2024-12-21T02:34:24Z","title":"Sensitive Image Classification by Vision Transformers","version":1},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-08-11T10:37:19.962272Z"},"links":{"citing_paper":"/paper/2412.16446"},"observation_digest":"sha256:40cdf02cee98e99a0e780f85d26ff48d8d6736bb9898d858bdec1bd57a782915","observation_id":"7be411ab-43b3-414e-aa24-e33a47363ac2","resolution":{"observed_at":"2026-08-11T10:37:20.243234Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T10:37:20.221984Z","title":"State-of-the-art in nudity classification: A comparative analysis,","venue":null,"work_id":"38fc7ab6-2c03-4a73-8464-a7808475c481","year":2023},"citing_paper":{"arxiv_id":"2412.16446","last_updated":"2024-12-21T02:34:24Z","snapshot_observed_at":"2026-08-13T14:59:50.836460Z","submitted_at":"2024-12-21T02:34:24Z","title":"Sensitive Image Classification by Vision Transformers","version":1},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-08-11T10:37:19.968555Z"},"links":{"citing_paper":"/paper/2412.16446"},"observation_digest":"sha256:2dfd429791a92b0e6fc05a246f8b219d357c8e6aa6d50a4b90dd00f6aef387a1","observation_id":"352f6087-b9a7-46c6-ba11-4eefa851e2c7","resolution":{"observed_at":"2026-08-11T10:37:20.227175Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T10:37:20.205196Z","title":"The Bumble’s private detector model","venue":null,"work_id":"2aab2931-ae40-4c4b-ba4c-31c6d094eb34","year":null},"citing_paper":{"arxiv_id":"2412.16446","last_updated":"2024-12-21T02:34:24Z","snapshot_observed_at":"2026-08-13T14:59:50.836460Z","submitted_at":"2024-12-21T02:34:24Z","title":"Sensitive Image Classification by Vision Transformers","version":1},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-08-11T10:37:19.972883Z"},"links":{"citing_paper":"/paper/2412.16446"},"observation_digest":"sha256:221564b72e0e9c6e6b40d652194ee714c038a162313ddd1fbfdc38c2ca061002","observation_id":"4279de66-d7ea-4b40-a2c3-8e65d9416397","resolution":{"observed_at":"2026-08-11T10:37:20.210155Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T10:37:20.189943Z","title":"EfficientNet: Rethinking model scaling for con- volutional neural networks,","venue":null,"work_id":"22c07fe3-5b6c-4bcd-b607-1278f2e073fb","year":2019},"citing_paper":{"arxiv_id":"2412.16446","last_updated":"2024-12-21T02:34:24Z","snapshot_observed_at":"2026-08-13T14:59:50.836460Z","submitted_at":"2024-12-21T02:34:24Z","title":"Sensitive Image Classification by Vision Transformers","version":1},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-08-11T10:37:19.977230Z"},"links":{"citing_paper":"/paper/2412.16446"},"observation_digest":"sha256:ca12a5e1f57abd0a0712c82db2fd8028ba9b619aa9ba90b4d6f083270394efcb","observation_id":"b35b030c-7f1d-4ef9-83c8-b7a96553033e","resolution":{"observed_at":"2026-08-11T10:37:20.194560Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}}],"paper":{"arxiv_id":"2412.16446","last_updated":"2024-12-21T02:34:24Z","latest_version":1,"primary_category":"cs.CV","snapshot_observed_at":"2026-08-13T14:59:50.836460Z","submitted_at":"2024-12-21T02:34:24Z","title":"Sensitive Image Classification by Vision Transformers"},"reference_resolution":{"displayed":35,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":10,"verified_exact":2,"verified_fuzzy":23},"total_outbound_references":35},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"thesis":"As of 15 August 2026, this Paper Citation Record lists 35 of 35 outbound references and 0 inbound Pith citation observations for arXiv:2412.16446."}