{"as_of":"2026-08-08T23:36:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:581dfd646a1fdc39f0b38358b75d96af7d63222a4289088ee1af03d3c9d5a716","coverage":[{"denominator":0,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":16,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":16,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-08T06:32:00.761636+00:00","state":"measured"},{"denominator":16,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":16,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-07T23:08:02.283463Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":1,"source":"arxiv_reference","source_observed_at":"2026-08-05T02:28:24.338817Z","state":"measured"}],"external_citation_measurements":[{"count":0,"observed_at":"2026-08-05T02:28:24.338817Z","source":"arxiv_reference"}],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2502.14744","last_updated":"2025-06-23T06:11:32Z","snapshot_observed_at":"2026-08-07T18:01:22.772663Z","submitted_at":"2025-02-20T17:14:34Z","title":"HiddenDetect: Detecting Jailbreak Attacks against Large Vision-Language Models via Monitoring Hidden States","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2502.14744","snapshot_observed_at":"2026-08-07T23:08:02.283463Z","title":"Hiddendetect: Detecting jailbreak attacks against large vision-language models via monitoring hidden states","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2502.09674","last_updated":"2025-05-27T08:40:42Z","snapshot_observed_at":"2026-08-07T22:55:15.992320Z","submitted_at":"2025-02-13T06:39:22Z","title":"The Hidden Dimensions of LLM Alignment: A Multi-Dimensional Analysis of Orthogonal Safety Directions","version":4},"reference_index":22,"source":"arxiv_source","source_observed_at":"2026-08-07T23:08:02.283463Z"},"links":{"cited_paper":"/paper/2502.14744","citing_paper":"/paper/2502.09674"},"observation_digest":"sha256:4e9352790d8873fb23a4d0f05d54b6a4b44a9e71a0a60a4ba9cf51ffbd968a57","observation_id":"d041aa4a-cf62-4cd8-a29d-8289e8798809","resolution":{"observed_at":"2026-08-07T23:08:02.283463Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2502.14744","last_updated":"2025-06-23T06:11:32Z","snapshot_observed_at":"2026-08-07T18:01:22.772663Z","submitted_at":"2025-02-20T17:14:34Z","title":"HiddenDetect: Detecting Jailbreak Attacks against Large Vision-Language Models via Monitoring Hidden States","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2502.14744","snapshot_observed_at":"2026-08-07T14:13:50.813253Z","title":"Hiddendetect: Detecting jailbreak attacks against large vision-language models via monitoring hidden states,","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2505.19690","last_updated":"2025-05-26T08:49:19Z","snapshot_observed_at":"2026-08-08T11:27:57.969115Z","submitted_at":"2025-05-26T08:49:19Z","title":"Beyond Safe Answers: A Benchmark for Evaluating True Risk Awareness in Large Reasoning Models","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-07T14:13:50.813253Z"},"links":{"cited_paper":"/paper/2502.14744","citing_paper":"/paper/2505.19690"},"observation_digest":"sha256:f6ab8199a8cd50289c2d8460ff651b985646d53923c80c3cd16bda05752985d0","observation_id":"01b9a4ff-b677-440c-aa06-5bcd0b721490","resolution":{"observed_at":"2026-08-07T14:13:50.813253Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2502.14744","last_updated":"2025-06-23T06:11:32Z","snapshot_observed_at":"2026-08-07T18:01:22.772663Z","submitted_at":"2025-02-20T17:14:34Z","title":"HiddenDetect: Detecting Jailbreak Attacks against Large Vision-Language Models via Monitoring Hidden States","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2502.14744","snapshot_observed_at":"2026-08-07T14:15:16.955465Z","title":"HiddenDetect: Detecting jailbreak attacks against large vision-language models via monitoring hidden states,","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2505.23793","last_updated":"2025-05-26T08:39:14Z","snapshot_observed_at":"2026-08-08T01:18:19.713600Z","submitted_at":"2025-05-26T08:39:14Z","title":"USB: A Comprehensive and Unified Safety Evaluation Benchmark for Multimodal Large Language Models","version":1},"reference_index":46,"source":"pdf_text","source_observed_at":"2026-08-07T14:15:16.955465Z"},"links":{"cited_paper":"/paper/2502.14744","citing_paper":"/paper/2505.23793"},"observation_digest":"sha256:aac857f5ab0c8640bd80dcbe45332977030b4fddb4ac38f61b1107637a11532f","observation_id":"94b3aef8-1d9f-4329-9fb6-cde640ea49e5","resolution":{"observed_at":"2026-08-07T14:15:16.955465Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2502.14744","last_updated":"2025-06-23T06:11:32Z","snapshot_observed_at":"2026-08-07T18:01:22.772663Z","submitted_at":"2025-02-20T17:14:34Z","title":"HiddenDetect: Detecting Jailbreak Attacks against Large Vision-Language Models via Monitoring Hidden States","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2502.14744","snapshot_observed_at":"2026-08-06T22:04:00.311613Z","title":"Jing, P., Cui, K., Guan, W., Nie, L., and Su, Y","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2506.22769","last_updated":"2025-06-28T06:13:13Z","snapshot_observed_at":"2026-08-06T21:55:50.977658Z","submitted_at":"2025-06-28T06:13:13Z","title":"Learning Efficient Robotic Garment Manipulation with Standardization","version":1},"reference_index":2025,"source":"pdf_text","source_observed_at":"2026-08-06T22:04:00.311613Z"},"links":{"cited_paper":"/paper/2502.14744","citing_paper":"/paper/2506.22769"},"observation_digest":"sha256:b49e8876c65b3396c05f7610a426b7301f9f60c95c1414b33013efda58c17b09","observation_id":"229bef39-207a-4fa2-a909-ede030294c61","resolution":{"observed_at":"2026-08-06T22:04:00.311613Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2502.14744","last_updated":"2025-06-23T06:11:32Z","snapshot_observed_at":"2026-08-07T18:01:22.772663Z","submitted_at":"2025-02-20T17:14:34Z","title":"HiddenDetect: Detecting Jailbreak Attacks against Large Vision-Language Models via Monitoring Hidden States","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2502.14744","snapshot_observed_at":"2026-08-05T22:21:02.791999Z","title":"Hiddendetect: Detecting jailbreak attacks against large vision-language models via monitoring hid- den states.arXiv preprint arXiv:2502.14744,","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2508.09206","last_updated":"2025-08-10T00:55:54Z","snapshot_observed_at":"2026-08-08T07:38:57.527462Z","submitted_at":"2025-08-10T00:55:54Z","title":"The First Differentiable Transfer-Based Algorithm for Discrete MicroLED Repair","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-05T22:21:02.791999Z"},"links":{"cited_paper":"/paper/2502.14744","citing_paper":"/paper/2508.09206"},"observation_digest":"sha256:2a850ae46959b45bc52b72fc077cf1a549a4b6c8c84cd13e9dc483ad733b49d9","observation_id":"e86577b5-cf63-4796-987f-4b919618607c","resolution":{"observed_at":"2026-08-05T22:21:02.791999Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2502.14744","last_updated":"2025-06-23T06:11:32Z","snapshot_observed_at":"2026-08-07T18:01:22.772663Z","submitted_at":"2025-02-20T17:14:34Z","title":"HiddenDetect: Detecting Jailbreak Attacks against Large Vision-Language Models via Monitoring Hidden States","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2502.14744","snapshot_observed_at":"2026-08-05T11:40:42.538039Z","title":"Hiddendetect: Detecting jailbreak attacks against large vision-language models via monitoring hidden states,","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2509.02324","last_updated":"2025-09-02T13:50:45Z","snapshot_observed_at":"2026-08-08T12:07:04.258402Z","submitted_at":"2025-09-02T13:50:45Z","title":"Language-Guided Long Horizon Manipulation with LLM-based Planning and Visual Perception","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-05T11:40:42.538039Z"},"links":{"cited_paper":"/paper/2502.14744","citing_paper":"/paper/2509.02324"},"observation_digest":"sha256:92e488c23ce81ffd7ac2e8d42f23f9e324328e300d30e33b24123789f6738860","observation_id":"7695229e-18a4-4341-b165-aed5a3105201","resolution":{"observed_at":"2026-08-05T11:40:42.538039Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2502.14744","last_updated":"2025-06-23T06:11:32Z","snapshot_observed_at":"2026-08-07T18:01:22.772663Z","submitted_at":"2025-02-20T17:14:34Z","title":"HiddenDetect: Detecting Jailbreak Attacks against Large Vision-Language Models via Monitoring Hidden States","version":4},"cited_work":{"arxiv_id":"2502.14744","doi":"10.48550/arxiv.2502.14744","metadata_source":"arxiv_reference","pith_arxiv_id":"2502.14744","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"doi:10.48550/arXiv.2502.14744 , abstract =","venue":"ArXiv.org","work_id":"4d6f7ddf-c9fe-4735-9fbd-61213ae88b45","year":2025},"citing_paper":{"arxiv_id":"2511.17408","last_updated":"2026-04-19T21:58:15Z","snapshot_observed_at":"2026-08-06T11:23:25.216358Z","submitted_at":"2025-11-21T17:08:48Z","title":"The Impact of Off-Policy Training Data on Probe Generalisation","version":4},"reference_index":21,"source":"arxiv_source","source_observed_at":"2026-05-17T20:26:37.914522Z"},"links":{"cited_paper":"/paper/2502.14744","citing_paper":"/paper/2511.17408"},"observation_digest":"sha256:e66b55518920eb932d888f711299e6fb0677c609a63dcf1839763275ffaed804","observation_id":"ca1cfab4-bcff-43a4-87ba-f32f77a1ec62","resolution":{"observed_at":"2026-05-17T20:30:11.638926Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2502.14744","last_updated":"2025-06-23T06:11:32Z","snapshot_observed_at":"2026-08-07T18:01:22.772663Z","submitted_at":"2025-02-20T17:14:34Z","title":"HiddenDetect: Detecting Jailbreak Attacks against Large Vision-Language Models via Monitoring Hidden States","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2502.14744","snapshot_observed_at":"2026-08-02T17:39:42.343655Z","title":"Hiddendetect: Detecting jailbreak attacks against large vision-language models via monitoring hidden states.arXiv preprint arXiv:2502.14744, 3(5),","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2603.23171","last_updated":"2026-07-29T15:06:33Z","snapshot_observed_at":"2026-08-08T17:14:23.529795Z","submitted_at":"2026-03-24T13:13:23Z","title":"Adaptively Robust LLM Monitoring via Activation Watermarking","version":3},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-02T17:39:42.343655Z"},"links":{"cited_paper":"/paper/2502.14744","citing_paper":"/paper/2603.23171"},"observation_digest":"sha256:f524db8815cc30bd7d490d91d0ddc3a53a820d9eb28f82f842d2823ed0104f65","observation_id":"2e4e9bf4-0386-432b-8f8c-e4ab437f8c22","resolution":{"observed_at":"2026-08-02T17:39:42.343655Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2502.14744","last_updated":"2025-06-23T06:11:32Z","snapshot_observed_at":"2026-08-07T18:01:22.772663Z","submitted_at":"2025-02-20T17:14:34Z","title":"HiddenDetect: Detecting Jailbreak Attacks against Large Vision-Language Models via Monitoring Hidden States","version":4},"cited_work":{"arxiv_id":"2502.14744","doi":"10.48550/arxiv.2502.14744","metadata_source":"arxiv_reference","pith_arxiv_id":"2502.14744","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"doi:10.48550/arXiv.2502.14744 , abstract =","venue":"ArXiv.org","work_id":"4d6f7ddf-c9fe-4735-9fbd-61213ae88b45","year":2025},"citing_paper":{"arxiv_id":"2604.06247","last_updated":"2026-04-06T16:29:05Z","snapshot_observed_at":"2026-07-06T22:54:48.916799Z","submitted_at":"2026-04-06T16:29:05Z","title":"SALLIE: Safeguarding Against Latent Language & Image Exploits","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-05-10T19:04:46.426969Z"},"links":{"cited_paper":"/paper/2502.14744","citing_paper":"/paper/2604.06247"},"observation_digest":"sha256:fd0a5d5391694a1b7c1cae2ed281e9e3533b633ccdc8418fa6e7c8e867f3a5f9","observation_id":"50728afd-4e83-48e5-bd82-072f1a15b810","resolution":{"observed_at":"2026-05-10T23:30:51.149721Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2502.14744","last_updated":"2025-06-23T06:11:32Z","snapshot_observed_at":"2026-08-07T18:01:22.772663Z","submitted_at":"2025-02-20T17:14:34Z","title":"HiddenDetect: Detecting Jailbreak Attacks against Large Vision-Language Models via Monitoring Hidden States","version":4},"cited_work":{"arxiv_id":"2502.14744","doi":"10.48550/arxiv.2502.14744","metadata_source":"arxiv_reference","pith_arxiv_id":"2502.14744","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"doi:10.48550/arXiv.2502.14744 , abstract =","venue":"ArXiv.org","work_id":"4d6f7ddf-c9fe-4735-9fbd-61213ae88b45","year":2025},"citing_paper":{"arxiv_id":"2605.03095","last_updated":"2026-05-04T19:17:50Z","snapshot_observed_at":"2026-07-06T23:16:05.372336Z","submitted_at":"2026-05-04T19:17:50Z","title":"Revisiting JBShield: Breaking and Rebuilding Representation-Level Jailbreak Defenses","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-05-07T02:16:49.785596Z"},"links":{"cited_paper":"/paper/2502.14744","citing_paper":"/paper/2605.03095"},"observation_digest":"sha256:cad7b09eed6f2f5642a37770bb38ed1cb6b1b5ae81f524c294984ede161b3444","observation_id":"36de01fb-8a2a-4e07-9ff4-c79d16720069","resolution":{"observed_at":"2026-05-12T10:46:31.207957Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2502.14744","last_updated":"2025-06-23T06:11:32Z","snapshot_observed_at":"2026-08-07T18:01:22.772663Z","submitted_at":"2025-02-20T17:14:34Z","title":"HiddenDetect: Detecting Jailbreak Attacks against Large Vision-Language Models via Monitoring Hidden States","version":4},"cited_work":{"arxiv_id":"2502.14744","doi":"10.48550/arxiv.2502.14744","metadata_source":"arxiv_reference","pith_arxiv_id":"2502.14744","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"doi:10.48550/arXiv.2502.14744 , abstract =","venue":"ArXiv.org","work_id":"4d6f7ddf-c9fe-4735-9fbd-61213ae88b45","year":2025},"citing_paper":{"arxiv_id":"2605.09391","last_updated":"2026-05-15T12:37:57Z","snapshot_observed_at":"2026-07-06T23:21:30.897592Z","submitted_at":"2026-05-10T07:38:34Z","title":"Do Linear Probes Generalize Better in Persona Coordinates?","version":1},"reference_index":24,"source":"arxiv_source","source_observed_at":"2026-05-12T04:47:47.214726Z"},"links":{"cited_paper":"/paper/2502.14744","citing_paper":"/paper/2605.09391"},"observation_digest":"sha256:ff2591402f517fe1d7c721620db54a07bce9aa680c319f3542eb785061e219e1","observation_id":"a7b36e3c-27d4-4ff6-9aa8-3827602b0d25","resolution":{"observed_at":"2026-05-12T04:51:22.869020Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2502.14744","last_updated":"2025-06-23T06:11:32Z","snapshot_observed_at":"2026-08-07T18:01:22.772663Z","submitted_at":"2025-02-20T17:14:34Z","title":"HiddenDetect: Detecting Jailbreak Attacks against Large Vision-Language Models via Monitoring Hidden States","version":4},"cited_work":{"arxiv_id":"2502.14744","doi":"10.48550/arxiv.2502.14744","metadata_source":"arxiv_reference","pith_arxiv_id":"2502.14744","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"doi:10.48550/arXiv.2502.14744 , abstract =","venue":"ArXiv.org","work_id":"4d6f7ddf-c9fe-4735-9fbd-61213ae88b45","year":2025},"citing_paper":{"arxiv_id":"2605.09391","last_updated":"2026-05-15T12:37:57Z","snapshot_observed_at":"2026-07-06T23:21:30.897592Z","submitted_at":"2026-05-10T07:38:34Z","title":"Do Linear Probes Generalize Better in Persona Coordinates?","version":2},"reference_index":24,"source":"arxiv_source","source_observed_at":"2026-05-19T17:06:22.481341Z"},"links":{"cited_paper":"/paper/2502.14744","citing_paper":"/paper/2605.09391"},"observation_digest":"sha256:ea4d1b0757f78b16a2af317f1417a964ab5db7e867336df1239198438c3a1335","observation_id":"6b828383-b64b-4f1c-995f-7f81925d40d4","resolution":{"observed_at":"2026-05-19T17:07:40.487059Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2502.14744","last_updated":"2025-06-23T06:11:32Z","snapshot_observed_at":"2026-08-07T18:01:22.772663Z","submitted_at":"2025-02-20T17:14:34Z","title":"HiddenDetect: Detecting Jailbreak Attacks against Large Vision-Language Models via Monitoring Hidden States","version":4},"cited_work":{"arxiv_id":"2502.14744","doi":"10.48550/arxiv.2502.14744","metadata_source":"arxiv_reference","pith_arxiv_id":"2502.14744","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"doi:10.48550/arXiv.2502.14744 , abstract =","venue":"ArXiv.org","work_id":"4d6f7ddf-c9fe-4735-9fbd-61213ae88b45","year":2025},"citing_paper":{"arxiv_id":"2606.07335","last_updated":"2026-06-05T14:49:26Z","snapshot_observed_at":"2026-07-06T23:47:00.425715Z","submitted_at":"2026-06-05T14:49:26Z","title":"Defending Jailbreak Attacks on Large Language Models via Manifold Trajectory Kinetics","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-06-27T21:55:48.561400Z"},"links":{"cited_paper":"/paper/2502.14744","citing_paper":"/paper/2606.07335"},"observation_digest":"sha256:750f67f2dacbb6d226d78f2bd3363909bfcdf42d7595ed7b8aaa882d0d687be2","observation_id":"a9da2504-4fff-4002-8acf-62ae90cc06e9","resolution":{"observed_at":"2026-07-02T17:37:14.918790Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2502.14744","last_updated":"2025-06-23T06:11:32Z","snapshot_observed_at":"2026-08-07T18:01:22.772663Z","submitted_at":"2025-02-20T17:14:34Z","title":"HiddenDetect: Detecting Jailbreak Attacks against Large Vision-Language Models via Monitoring Hidden States","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2502.14744","snapshot_observed_at":"2026-08-02T06:30:55.207937Z","title":"Jiang, X","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.14147","last_updated":"2026-07-14T09:30:34Z","snapshot_observed_at":"2026-08-04T23:11:22.577320Z","submitted_at":"2026-07-14T09:30:34Z","title":"Breaking Refusal in the First Half: A Mechanistic Study of the Prefill Jailbreak","version":1},"reference_index":40,"source":"arxiv_source","source_observed_at":"2026-08-02T06:30:55.207937Z"},"links":{"cited_paper":"/paper/2502.14744","citing_paper":"/paper/2607.14147"},"observation_digest":"sha256:d676f084092ec93c320ad0a67d87557768cf978937a23d4634f78aacd28cbde2","observation_id":"be50c1f4-ba70-4939-be24-6620ae2bb353","resolution":{"observed_at":"2026-08-02T06:30:55.207937Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2502.14744","last_updated":"2025-06-23T06:11:32Z","snapshot_observed_at":"2026-08-07T18:01:22.772663Z","submitted_at":"2025-02-20T17:14:34Z","title":"HiddenDetect: Detecting Jailbreak Attacks against Large Vision-Language Models via Monitoring Hidden States","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2502.14744","snapshot_observed_at":"2026-08-01T08:23:30.045950Z","title":"Hiddendetect: Detecting jailbreak attacks against large vision-language models via monitoring hidden states,","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.21151","last_updated":"2026-07-26T23:23:12Z","snapshot_observed_at":"2026-08-06T16:53:45.184525Z","submitted_at":"2026-07-23T10:35:38Z","title":"V-DEAL: Diagnosing Video Safety De-Calibration as an Understanding-Refusal Coupling Failure","version":2},"reference_index":48,"source":"pdf_text","source_observed_at":"2026-08-01T08:23:30.045950Z"},"links":{"cited_paper":"/paper/2502.14744","citing_paper":"/paper/2607.21151"},"observation_digest":"sha256:a4a396c3008295286dc964256955bd7a04a69ca39e8f2a5a187b5ccc3aeab78d","observation_id":"5b3c30c2-be6d-4e5c-80de-9472927ce71b","resolution":{"observed_at":"2026-08-01T08:23:30.045950Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2502.14744","last_updated":"2025-06-23T06:11:32Z","snapshot_observed_at":"2026-08-07T18:01:22.772663Z","submitted_at":"2025-02-20T17:14:34Z","title":"HiddenDetect: Detecting Jailbreak Attacks against Large Vision-Language Models via Monitoring Hidden States","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2502.14744","snapshot_observed_at":"2026-08-07T21:24:15.051214Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2608.05909","last_updated":"2026-08-06T11:39:08Z","snapshot_observed_at":"2026-08-08T23:17:09.940920Z","submitted_at":"2026-08-06T11:39:08Z","title":"MMAligner: Safeguarding Multimodal Large Language Models through Representation Calibration","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-07T21:24:15.051214Z"},"links":{"cited_paper":"/paper/2502.14744","citing_paper":"/paper/2608.05909"},"observation_digest":"sha256:46c013b023dd4682ba59aac19d70da86cde00849d8b1e9e6097da3d79f44e2bc","observation_id":"0e77d1f4-25a7-4ee5-865a-c23ebb2261b2","resolution":{"observed_at":"2026-08-07T21:24:15.051214Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"links":{"evidence":"/evidence","html":"/paper/2502.14744/citation-record","integrity":"/paper/2502.14744/integrity","json":"/paper/2502.14744/citation-record.json","paper":"/paper/2502.14744"},"outbound":[],"paper":{"arxiv_id":"2502.14744","last_updated":"2025-06-23T06:11:32Z","latest_version":4,"primary_category":"cs.CL","snapshot_observed_at":"2026-08-07T18:01:22.772663Z","submitted_at":"2025-02-20T17:14:34Z","title":"HiddenDetect: Detecting Jailbreak Attacks against Large Vision-Language Models via Monitoring Hidden States"},"reference_resolution":{"displayed":0,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":0,"verified_exact":0,"verified_fuzzy":0},"total_outbound_references":0},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"thesis":"As of 8 August 2026, this Paper Citation Record lists 0 of 0 outbound references and 16 inbound Pith citation observations for arXiv:2502.14744."}