{"as_of":"2026-08-09T09:48:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:8beb383812343cd887ca23867fb36dfe801f97a73ac65b87ddad81ad4e1e845a","coverage":[{"denominator":58,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":58,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-07T13:17:25.808065Z","state":"measured"},{"denominator":60,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":60,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-09T06:31:02.800959+00:00","state":"measured"},{"denominator":2,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":2,"source":"paper_references, paper_reference_links","source_observed_at":"2026-06-30T07:14:32.902738Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"arxiv_reference","source_observed_at":"2026-06-30T07:24:22.504297Z","state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2505.22271","last_updated":"2025-05-28T11:57:46Z","snapshot_observed_at":"2026-08-07T13:09:00.589520Z","submitted_at":"2025-05-28T11:57:46Z","title":"Test-Time Immunization: A Universal Defense Framework Against Jailbreaks for (Multimodal) Large Language Models","version":1},"cited_work":{"arxiv_id":"2505.22271","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2505.22271","snapshot_observed_at":"2026-06-30T07:24:22.504297Z","title":"arXiv preprint arXiv:2505.22271 (2025)","venue":null,"work_id":"39a4ba8a-81e0-4950-a2ce-4b3d6694f6fc","year":2025},"citing_paper":{"arxiv_id":"2604.21327","last_updated":"2026-04-23T06:32:08Z","snapshot_observed_at":"2026-07-06T23:07:56.487654Z","submitted_at":"2026-04-23T06:32:08Z","title":"Understanding and Mitigating Spurious Signal Amplification in Test-Time Reinforcement Learning for Math Reasoning","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-05-09T22:55:19.471307Z"},"links":{"cited_paper":"/paper/2505.22271","citing_paper":"/paper/2604.21327"},"observation_digest":"sha256:a109de4b0e84658d1f76fb990da6625e53cc61e0fa2171c6f830586d44025570","observation_id":"1b1d1d6c-e1c3-4414-b792-8952e4fd56f8","resolution":{"observed_at":"2026-05-11T14:16:07.293158Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2505.22271","last_updated":"2025-05-28T11:57:46Z","snapshot_observed_at":"2026-08-07T13:09:00.589520Z","submitted_at":"2025-05-28T11:57:46Z","title":"Test-Time Immunization: A Universal Defense Framework Against Jailbreaks for (Multimodal) Large Language Models","version":1},"cited_work":{"arxiv_id":"2505.22271","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2505.22271","snapshot_observed_at":"2026-06-30T07:24:22.504297Z","title":"arXiv preprint arXiv:2505.22271 (2025)","venue":null,"work_id":"39a4ba8a-81e0-4950-a2ce-4b3d6694f6fc","year":2025},"citing_paper":{"arxiv_id":"2606.30360","last_updated":"2026-06-29T14:26:13Z","snapshot_observed_at":"2026-08-02T18:18:55.136020Z","submitted_at":"2026-06-29T14:26:13Z","title":"On the Vulnerability of Parameter-Level Defenses to Model Merging","version":1},"reference_index":47,"source":"pdf_text","source_observed_at":"2026-06-30T07:14:32.902738Z"},"links":{"cited_paper":"/paper/2505.22271","citing_paper":"/paper/2606.30360"},"observation_digest":"sha256:35459c11fcaf495fa68cc711f5819537f38636b1428e7ae64fafd54d0e5063fa","observation_id":"ca574ac8-d05a-48c1-b5d0-5f3862ed884f","resolution":{"observed_at":"2026-06-30T07:24:22.505907Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}}],"links":{"evidence":"/evidence","html":"/paper/2505.22271/citation-record","integrity":"/paper/2505.22271/integrity","json":"/paper/2505.22271/citation-record.json","paper":"/paper/2505.22271"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:17:32.082598Z","title":"Jail- breaking black box large language models in twenty queries","venue":null,"work_id":"06b7e720-08f8-4f79-95da-23abdd936ddb","year":2024},"citing_paper":{"arxiv_id":"2505.22271","last_updated":"2025-05-28T11:57:46Z","snapshot_observed_at":"2026-08-07T13:09:00.589520Z","submitted_at":"2025-05-28T11:57:46Z","title":"Test-Time Immunization: A Universal Defense Framework Against Jailbreaks for (Multimodal) Large Language Models","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-07T13:17:19.788942Z"},"links":{"citing_paper":"/paper/2505.22271"},"observation_digest":"sha256:f47cc30ebfc214f7a8ab4564387348fa2aafc5572cc9b789cf226b2ba43bd017","observation_id":"0845ab38-c298-47da-892c-114ca7a9cc98","resolution":{"observed_at":"2026-08-07T13:17:32.148838Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:17:19.865083Z","title":"Vicuna: An open-source chatbot impressing gpt-4 with 90%* chatgpt quality.See https://vicuna","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.22271","last_updated":"2025-05-28T11:57:46Z","snapshot_observed_at":"2026-08-07T13:09:00.589520Z","submitted_at":"2025-05-28T11:57:46Z","title":"Test-Time Immunization: A Universal Defense Framework Against Jailbreaks for (Multimodal) Large Language Models","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-07T13:17:19.865083Z"},"links":{"citing_paper":"/paper/2505.22271"},"observation_digest":"sha256:0cc2fc6d0413d741b8635195ca3b4e5be3c2010e09cfbe64e338e21d44298ce1","observation_id":"1c145bd4-d723-40d5-b022-ac9644772aa2","resolution":{"observed_at":"2026-08-07T13:17:19.865083Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:17:31.885986Z","title":"Security and privacy challenges of large language models: A survey.ACM Computing Surveys, 2024","venue":null,"work_id":"7cf21c4d-1d09-4859-9eec-9de81fcdcdf7","year":2024},"citing_paper":{"arxiv_id":"2505.22271","last_updated":"2025-05-28T11:57:46Z","snapshot_observed_at":"2026-08-07T13:09:00.589520Z","submitted_at":"2025-05-28T11:57:46Z","title":"Test-Time Immunization: A Universal Defense Framework Against Jailbreaks for (Multimodal) Large Language Models","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-07T13:17:19.978460Z"},"links":{"citing_paper":"/paper/2505.22271"},"observation_digest":"sha256:88cfcdc9354af6ebd1c52decb80b889b7d2f7f325571c29bd96f36cc7b4a4f07","observation_id":"c3f63183-8f51-498a-8548-e17478612deb","resolution":{"observed_at":"2026-08-07T13:17:32.006849Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:17:31.684530Z","title":"Libre: A practical bayesian approach to adversarial detection","venue":null,"work_id":"0cf76676-76f3-4332-b62b-b3b2ce4a43d0","year":2021},"citing_paper":{"arxiv_id":"2505.22271","last_updated":"2025-05-28T11:57:46Z","snapshot_observed_at":"2026-08-07T13:09:00.589520Z","submitted_at":"2025-05-28T11:57:46Z","title":"Test-Time Immunization: A Universal Defense Framework Against Jailbreaks for (Multimodal) Large Language Models","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-07T13:17:20.096904Z"},"links":{"citing_paper":"/paper/2505.22271"},"observation_digest":"sha256:55afa5b359b8daa6b082b3ddbf5102a88059fa82c6ad4d2537de147f2ca97920","observation_id":"d8fdbdc4-059f-4bb3-9e02-b421cdfee5b9","resolution":{"observed_at":"2026-08-07T13:17:31.760169Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2411.18688","last_updated":"2025-06-14T04:20:06Z","snapshot_observed_at":"2026-07-06T19:58:13.816588Z","submitted_at":"2024-11-27T19:00:10Z","title":"Immune: Improving Safety Against Jailbreaks in Multi-modal LLMs via Inference-Time Alignment","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2411.18688","snapshot_observed_at":"2026-08-07T13:17:20.181959Z","title":"Immune: Improving safety against jailbreaks in multi-modal llms via inference-time alignment.arXiv preprint arXiv:2411.18688, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.22271","last_updated":"2025-05-28T11:57:46Z","snapshot_observed_at":"2026-08-07T13:09:00.589520Z","submitted_at":"2025-05-28T11:57:46Z","title":"Test-Time Immunization: A Universal Defense Framework Against Jailbreaks for (Multimodal) Large Language Models","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-07T13:17:20.181959Z"},"links":{"cited_paper":"/paper/2411.18688","citing_paper":"/paper/2505.22271"},"observation_digest":"sha256:6cc85069849c23799fe634ee1fdbb54b1ca4bcb96a7bcee25b5ae6fa2075fa87","observation_id":"28b528c5-886b-46d1-9e51-7b3eaa387197","resolution":{"observed_at":"2026-08-07T13:17:20.181959Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2311.05608","last_updated":"2025-01-19T16:23:38Z","snapshot_observed_at":"2026-07-06T16:45:24.070954Z","submitted_at":"2023-11-09T18:59:11Z","title":"FigStep: Jailbreaking Large Vision-Language Models via Typographic Visual Prompts","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2311.05608","snapshot_observed_at":"2026-08-07T13:17:20.261903Z","title":"Figstep: Jailbreaking large vision-language models via typographic visual prompts.arXiv preprint arXiv:2311.05608, 2023","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.22271","last_updated":"2025-05-28T11:57:46Z","snapshot_observed_at":"2026-08-07T13:09:00.589520Z","submitted_at":"2025-05-28T11:57:46Z","title":"Test-Time Immunization: A Universal Defense Framework Against Jailbreaks for (Multimodal) Large Language Models","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-07T13:17:20.261903Z"},"links":{"cited_paper":"/paper/2311.05608","citing_paper":"/paper/2505.22271"},"observation_digest":"sha256:5e3344991c885afbf3d151d2012af08275a48f92aed00df7cf9c34dcdf3745db","observation_id":"c9a16fcf-f021-4a0c-a6cb-addc007f4cbc","resolution":{"observed_at":"2026-08-07T13:17:20.261903Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:17:31.511213Z","title":"Eyes closed, safety on: Protecting multimodal llms via image-to-text transformation","venue":null,"work_id":"6fcebd33-99db-4d0d-ab5e-a7c2efc29ee4","year":2024},"citing_paper":{"arxiv_id":"2505.22271","last_updated":"2025-05-28T11:57:46Z","snapshot_observed_at":"2026-08-07T13:09:00.589520Z","submitted_at":"2025-05-28T11:57:46Z","title":"Test-Time Immunization: A Universal Defense Framework Against Jailbreaks for (Multimodal) Large Language Models","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-07T13:17:20.426606Z"},"links":{"citing_paper":"/paper/2505.22271"},"observation_digest":"sha256:79abf02e68f1f0956eb5a80c8e793806ceb0c638a93f0bda01dfdefefc79b569","observation_id":"a25ac3bc-1770-46f9-a19e-f3a7d20911e4","resolution":{"observed_at":"2026-08-07T13:17:31.578334Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:17:31.301868Z","title":"Backdoor defense via test-time detecting and repairing","venue":null,"work_id":"22d86a26-168a-47b2-a08b-0196a2e37c9b","year":2024},"citing_paper":{"arxiv_id":"2505.22271","last_updated":"2025-05-28T11:57:46Z","snapshot_observed_at":"2026-08-07T13:09:00.589520Z","submitted_at":"2025-05-28T11:57:46Z","title":"Test-Time Immunization: A Universal Defense Framework Against Jailbreaks for (Multimodal) Large Language Models","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-07T13:17:20.512808Z"},"links":{"citing_paper":"/paper/2505.22271"},"observation_digest":"sha256:db0a63cb7643368c7e29d1822a9e07e098b0f09432c74dc2c6c6c524edae86ec","observation_id":"56d8d03a-0245-461d-8177-ffdcaf057196","resolution":{"observed_at":"2026-08-07T13:17:31.441131Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:17:31.116734Z","title":"LoRA: Low-rank adaptation of large language models","venue":null,"work_id":"e9d4d914-2b41-4d96-88d3-73237ca0da5f","year":2022},"citing_paper":{"arxiv_id":"2505.22271","last_updated":"2025-05-28T11:57:46Z","snapshot_observed_at":"2026-08-07T13:09:00.589520Z","submitted_at":"2025-05-28T11:57:46Z","title":"Test-Time Immunization: A Universal Defense Framework Against Jailbreaks for (Multimodal) Large Language Models","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-07T13:17:20.596521Z"},"links":{"citing_paper":"/paper/2505.22271"},"observation_digest":"sha256:75e8115180f62ef0843a19950c9fc7cf6346fa8ad3d56e96267ecf32f775060b","observation_id":"94d78a55-b09e-488b-9eca-0cac1d718256","resolution":{"observed_at":"2026-08-07T13:17:31.213043Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2311.11509","last_updated":"2024-02-18T06:04:27Z","snapshot_observed_at":"2026-07-06T16:49:45.821983Z","submitted_at":"2023-11-20T03:17:21Z","title":"Token-Level Adversarial Prompt Detection Based on Perplexity Measures and Contextual Information","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2311.11509","snapshot_observed_at":"2026-08-07T13:17:20.682371Z","title":"Token-level adversarial prompt detection based on perplexity measures and contextual information.arXiv preprint arXiv:2311.11509, 2023","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.22271","last_updated":"2025-05-28T11:57:46Z","snapshot_observed_at":"2026-08-07T13:09:00.589520Z","submitted_at":"2025-05-28T11:57:46Z","title":"Test-Time Immunization: A Universal Defense Framework Against Jailbreaks for (Multimodal) Large Language Models","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-07T13:17:20.682371Z"},"links":{"cited_paper":"/paper/2311.11509","citing_paper":"/paper/2505.22271"},"observation_digest":"sha256:19a986597f19f05fe89e471dfcf409e9a08641d4ab50a5038ef974f5ab3a2aca","observation_id":"ebd8e886-f4c4-4b3e-8b47-b31162f717af","resolution":{"observed_at":"2026-08-07T13:17:20.682371Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2309.00614","last_updated":"2023-09-04T17:47:36Z","snapshot_observed_at":"2026-07-06T16:13:23.343694Z","submitted_at":"2023-09-01T17:59:44Z","title":"Baseline Defenses for Adversarial Attacks Against Aligned Language Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2309.00614","snapshot_observed_at":"2026-08-07T13:17:20.741888Z","title":"Baseline defenses for adversarial attacks against aligned language models.arXiv preprint arXiv:2309.00614, 2023","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.22271","last_updated":"2025-05-28T11:57:46Z","snapshot_observed_at":"2026-08-07T13:09:00.589520Z","submitted_at":"2025-05-28T11:57:46Z","title":"Test-Time Immunization: A Universal Defense Framework Against Jailbreaks for (Multimodal) Large Language Models","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-07T13:17:20.741888Z"},"links":{"cited_paper":"/paper/2309.00614","citing_paper":"/paper/2505.22271"},"observation_digest":"sha256:c2c700a44a6f7b604b9241fe7c7562e7827978af3401e38e4d2f71b58d848260","observation_id":"6ce751ab-57da-4788-b53e-d3e10dbe983f","resolution":{"observed_at":"2026-08-07T13:17:20.741888Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2310.06825","last_updated":"2023-10-10T17:54:58Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2023-10-10T17:54:58Z","title":"Mistral 7B","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2310.06825","snapshot_observed_at":"2026-08-07T13:17:20.801958Z","title":"Mistral 7b.arXiv preprint arXiv:2310.06825, 2023","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2505.22271","last_updated":"2025-05-28T11:57:46Z","snapshot_observed_at":"2026-08-07T13:09:00.589520Z","submitted_at":"2025-05-28T11:57:46Z","title":"Test-Time Immunization: A Universal Defense Framework Against Jailbreaks for (Multimodal) Large Language Models","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-07T13:17:20.801958Z"},"links":{"cited_paper":"/paper/2310.06825","citing_paper":"/paper/2505.22271"},"observation_digest":"sha256:e20092cabfd5136f5af55aa78cb3c3e9a5078bdf7ca79d0409e42dab05b83671","observation_id":"b125cd62-7fce-480b-90cf-ee3be2e2cfdc","resolution":{"observed_at":"2026-08-07T13:17:20.801958Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:17:20.872477Z","title":"Jailbreakzoo: Survey, landscapes, and horizons in jailbreaking large language and vision-language models.arXiv preprint arXiv:2407.01599, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.22271","last_updated":"2025-05-28T11:57:46Z","snapshot_observed_at":"2026-08-07T13:09:00.589520Z","submitted_at":"2025-05-28T11:57:46Z","title":"Test-Time Immunization: A Universal Defense Framework Against Jailbreaks for (Multimodal) Large Language Models","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-07T13:17:20.872477Z"},"links":{"citing_paper":"/paper/2505.22271"},"observation_digest":"sha256:98e2299f29a5357b2c1ec1fdb44ae14242980570105856eefc791730536035cc","observation_id":"fdf4814e-1a02-44cf-b5bc-3f087104aea1","resolution":{"observed_at":"2026-08-07T13:17:20.872477Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:17:20.980016Z","title":"A survey of reinforcement learning from human feedback.arXiv preprint arXiv:2312.14925, 2023","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.22271","last_updated":"2025-05-28T11:57:46Z","snapshot_observed_at":"2026-08-07T13:09:00.589520Z","submitted_at":"2025-05-28T11:57:46Z","title":"Test-Time Immunization: A Universal Defense Framework Against Jailbreaks for (Multimodal) Large Language Models","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-07T13:17:20.980016Z"},"links":{"citing_paper":"/paper/2505.22271"},"observation_digest":"sha256:0ba002227920ddfc8d786df9624851937b05c863538e42f4bd94c27359b06617","observation_id":"a9945a9f-ca74-4f71-aefc-a281a6f69a1a","resolution":{"observed_at":"2026-08-07T13:17:20.980016Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1412.6980","last_updated":"2017-01-30T01:27:54Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2014-12-22T13:54:29Z","title":"Adam: A Method for Stochastic Optimization","version":9},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1412.6980","snapshot_observed_at":"2026-08-07T13:17:21.040516Z","title":"Adam: A method for stochastic optimization.arXiv preprint arXiv:1412.6980, 2014","venue":null,"work_id":null,"year":2014},"citing_paper":{"arxiv_id":"2505.22271","last_updated":"2025-05-28T11:57:46Z","snapshot_observed_at":"2026-08-07T13:09:00.589520Z","submitted_at":"2025-05-28T11:57:46Z","title":"Test-Time Immunization: A Universal Defense Framework Against Jailbreaks for (Multimodal) Large Language Models","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-07T13:17:21.040516Z"},"links":{"cited_paper":"/paper/1412.6980","citing_paper":"/paper/2505.22271"},"observation_digest":"sha256:fc2e96f87a30dc32f37d1f683426c6c018943f27eddcfc78bb4726c63b0521a3","observation_id":"49499c2f-bc9e-40e6-8a97-278451b82a47","resolution":{"observed_at":"2026-08-07T13:17:21.040516Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2309.02705","last_updated":"2025-02-04T19:47:09Z","snapshot_observed_at":"2026-07-06T16:15:00.517258Z","submitted_at":"2023-09-06T04:37:20Z","title":"Certifying LLM Safety against Adversarial Prompting","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2309.02705","snapshot_observed_at":"2026-08-07T13:17:21.099918Z","title":"Certifying llm safety against adversarial prompting.arXiv preprint arXiv:2309.02705, 2023","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.22271","last_updated":"2025-05-28T11:57:46Z","snapshot_observed_at":"2026-08-07T13:09:00.589520Z","submitted_at":"2025-05-28T11:57:46Z","title":"Test-Time Immunization: A Universal Defense Framework Against Jailbreaks for (Multimodal) Large Language Models","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-07T13:17:21.099918Z"},"links":{"cited_paper":"/paper/2309.02705","citing_paper":"/paper/2505.22271"},"observation_digest":"sha256:2e51f26db91033f8250318101cf55a98744a72683961809e21609aff7d242530","observation_id":"d3eb8416-463e-4425-b4f4-9836979c048e","resolution":{"observed_at":"2026-08-07T13:17:21.099918Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:17:30.815571Z","title":"A comprehensive survey on test-time adaptation under distribution shifts","venue":null,"work_id":"11b7c4c3-af43-412a-a9d5-beaba28a47e9","year":2024},"citing_paper":{"arxiv_id":"2505.22271","last_updated":"2025-05-28T11:57:46Z","snapshot_observed_at":"2026-08-07T13:09:00.589520Z","submitted_at":"2025-05-28T11:57:46Z","title":"Test-Time Immunization: A Universal Defense Framework Against Jailbreaks for (Multimodal) Large Language Models","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-07T13:17:21.172373Z"},"links":{"citing_paper":"/paper/2505.22271"},"observation_digest":"sha256:e292bf37fe22424963843051765f40b6a2ce9636008592e6237bf0f2ebb304fa","observation_id":"cca613c9-a9fb-45e4-ba0a-58e1e7eaacc5","resolution":{"observed_at":"2026-08-07T13:17:30.926981Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2409.14940","last_updated":"2024-09-23T11:46:38Z","snapshot_observed_at":"2026-08-02T11:45:14.558498Z","submitted_at":"2024-09-23T11:46:38Z","title":"Improving Adversarial Robustness for 3D Point Cloud Recognition at Test-Time through Purified Self-Training","version":1},"cited_work":{"arxiv_id":"2409.14940","doi":null,"metadata_source":"pith","pith_arxiv_id":"2409.14940","snapshot_observed_at":"2026-08-07T13:17:26.397454Z","title":"Improving Adversarial Robustness for 3D Point Cloud Recognition at Test-Time through Purified Self-Training","venue":"cs.CV","work_id":"7bb3e933-a3ff-45c4-9ba6-a67f85cf419d","year":2024},"citing_paper":{"arxiv_id":"2505.22271","last_updated":"2025-05-28T11:57:46Z","snapshot_observed_at":"2026-08-07T13:09:00.589520Z","submitted_at":"2025-05-28T11:57:46Z","title":"Test-Time Immunization: A Universal Defense Framework Against Jailbreaks for (Multimodal) Large Language Models","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-07T13:17:21.252772Z"},"links":{"cited_paper":"/paper/2409.14940","citing_paper":"/paper/2505.22271"},"observation_digest":"sha256:5a328c42626236a044b696d323e02fa5603aca46eedfa805889c44c23fb36e85","observation_id":"f362cc21-f395-49d3-81e4-6932e4aa58b7","resolution":{"observed_at":"2026-08-07T13:17:26.486041Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:17:30.645098Z","title":"Microsoft coco: Common objects in context","venue":null,"work_id":"e22bba7b-b7f5-4e7e-9e37-51550f3a2e75","year":2014},"citing_paper":{"arxiv_id":"2505.22271","last_updated":"2025-05-28T11:57:46Z","snapshot_observed_at":"2026-08-07T13:09:00.589520Z","submitted_at":"2025-05-28T11:57:46Z","title":"Test-Time Immunization: A Universal Defense Framework Against Jailbreaks for (Multimodal) Large Language Models","version":1},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-07T13:17:21.335139Z"},"links":{"citing_paper":"/paper/2505.22271"},"observation_digest":"sha256:5b973c2fd1faaa610a4b159a0d6ed7d37c28d5e7d4d8cef83e7b1a8b2ab6fd53","observation_id":"56d86f8b-23fe-4037-8a6b-b44366b4e45b","resolution":{"observed_at":"2026-08-07T13:17:30.735860Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:17:30.465945Z","title":"Visual instruction tuning","venue":null,"work_id":"46c4a4a4-497e-43ec-98cd-ca474f303d31","year":2023},"citing_paper":{"arxiv_id":"2505.22271","last_updated":"2025-05-28T11:57:46Z","snapshot_observed_at":"2026-08-07T13:09:00.589520Z","submitted_at":"2025-05-28T11:57:46Z","title":"Test-Time Immunization: A Universal Defense Framework Against Jailbreaks for (Multimodal) Large Language Models","version":1},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-07T13:17:21.358161Z"},"links":{"citing_paper":"/paper/2505.22271"},"observation_digest":"sha256:bd972ad0655572db1848dc8c05a8b2efcbb0f47b502612bd57bbdf1a777fa244","observation_id":"81052493-b28b-46d9-88a6-801b8ddb13c9","resolution":{"observed_at":"2026-08-07T13:17:30.563054Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:17:30.300379Z","title":"Improved baselines with visual instruction tuning","venue":null,"work_id":"acf2532e-5462-40ba-8739-0e2e93fb4261","year":2024},"citing_paper":{"arxiv_id":"2505.22271","last_updated":"2025-05-28T11:57:46Z","snapshot_observed_at":"2026-08-07T13:09:00.589520Z","submitted_at":"2025-05-28T11:57:46Z","title":"Test-Time Immunization: A Universal Defense Framework Against Jailbreaks for (Multimodal) Large Language Models","version":1},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-07T13:17:21.380289Z"},"links":{"citing_paper":"/paper/2505.22271"},"observation_digest":"sha256:4dc9fa9422c28ad0f65599dd740032bc2f6539111ee53c8d3f88c118ed3eda71","observation_id":"ab48208f-11ce-47fd-b197-841d233cf260","resolution":{"observed_at":"2026-08-07T13:17:30.388861Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:17:30.119186Z","title":"Llava-next: Improved reasoning, ocr, and world knowledge, January 2024","venue":null,"work_id":"d6c7dbcb-d67d-421e-90e2-2fe7c23f70ab","year":2024},"citing_paper":{"arxiv_id":"2505.22271","last_updated":"2025-05-28T11:57:46Z","snapshot_observed_at":"2026-08-07T13:09:00.589520Z","submitted_at":"2025-05-28T11:57:46Z","title":"Test-Time Immunization: A Universal Defense Framework Against Jailbreaks for (Multimodal) Large Language Models","version":1},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-07T13:17:21.466300Z"},"links":{"citing_paper":"/paper/2505.22271"},"observation_digest":"sha256:8a98666cd3b22490377ef2ad1a235b2e7bd992c898a49cf19ce53df02bdb699e","observation_id":"fb5e1d04-325b-44fd-af20-b51ab3eb58dc","resolution":{"observed_at":"2026-08-07T13:17:30.185100Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:17:29.973041Z","title":"Autodan: Generating stealthy jailbreak prompts on aligned large language models","venue":null,"work_id":"49c45bef-429a-4e72-a1d6-a1c503652714","year":2024},"citing_paper":{"arxiv_id":"2505.22271","last_updated":"2025-05-28T11:57:46Z","snapshot_observed_at":"2026-08-07T13:09:00.589520Z","submitted_at":"2025-05-28T11:57:46Z","title":"Test-Time Immunization: A Universal Defense Framework Against Jailbreaks for (Multimodal) Large Language Models","version":1},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-07T13:17:21.544145Z"},"links":{"citing_paper":"/paper/2505.22271"},"observation_digest":"sha256:043ace32382c0e13781edb53ec17e2837f89a5b64c9450a137c7dfb2e1069fa6","observation_id":"ad404526-d415-4378-923c-64374aeebaf4","resolution":{"observed_at":"2026-08-07T13:17:30.018038Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:17:29.754034Z","title":"Mm-safetybench: A benchmark for safety evaluation of multimodal large language models","venue":null,"work_id":"8dec8692-ea90-49c8-a17b-d085f651acdc","year":2024},"citing_paper":{"arxiv_id":"2505.22271","last_updated":"2025-05-28T11:57:46Z","snapshot_observed_at":"2026-08-07T13:09:00.589520Z","submitted_at":"2025-05-28T11:57:46Z","title":"Test-Time Immunization: A Universal Defense Framework Against Jailbreaks for (Multimodal) Large Language Models","version":1},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-08-07T13:17:21.608032Z"},"links":{"citing_paper":"/paper/2505.22271"},"observation_digest":"sha256:07352b7402737ee058ad19286c172900904fc92581682ec04c57b76f0a22556d","observation_id":"c9f5fa92-8fd8-4632-8983-76ee67e6b68d","resolution":{"observed_at":"2026-08-07T13:17:29.858044Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2307.06435","last_updated":"2024-10-17T01:10:40Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2023-07-12T20:01:52Z","title":"A Comprehensive Overview of Large Language Models","version":10},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2307.06435","snapshot_observed_at":"2026-08-07T13:17:21.675739Z","title":"A comprehensive overview of large language models.arXiv preprint arXiv:2307.06435, 2023","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.22271","last_updated":"2025-05-28T11:57:46Z","snapshot_observed_at":"2026-08-07T13:09:00.589520Z","submitted_at":"2025-05-28T11:57:46Z","title":"Test-Time Immunization: A Universal Defense Framework Against Jailbreaks for (Multimodal) Large Language Models","version":1},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-08-07T13:17:21.675739Z"},"links":{"cited_paper":"/paper/2307.06435","citing_paper":"/paper/2505.22271"},"observation_digest":"sha256:0c46350d6299c131c7c23f2574acd6fb7ecb0b4a3963d69386aaf59849580b9f","observation_id":"4bfeaadc-76ec-4cae-9a69-21bf527f2e44","resolution":{"observed_at":"2026-08-07T13:17:21.675739Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:17:29.586858Z","title":"Dad: Data-free adversarial defense at test time","venue":null,"work_id":"3ab8405b-67d7-4e3f-9441-a0e843128632","year":2022},"citing_paper":{"arxiv_id":"2505.22271","last_updated":"2025-05-28T11:57:46Z","snapshot_observed_at":"2026-08-07T13:09:00.589520Z","submitted_at":"2025-05-28T11:57:46Z","title":"Test-Time Immunization: A Universal Defense Framework Against Jailbreaks for (Multimodal) Large Language Models","version":1},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-08-07T13:17:21.768487Z"},"links":{"citing_paper":"/paper/2505.22271"},"observation_digest":"sha256:e70bdb99896245ed7a70035b9e82d7f4de260d2f4c2f017b62835711d2116713","observation_id":"a4f2856b-434f-4975-a618-78152c1cfdb3","resolution":{"observed_at":"2026-08-07T13:17:29.660346Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2303.08774","last_updated":"2024-03-04T06:01:33Z","snapshot_observed_at":"2026-08-07T07:30:12.213965Z","submitted_at":"2023-03-15T17:15:04Z","title":"GPT-4 Technical Report","version":6},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2303.08774","snapshot_observed_at":"2026-08-07T13:17:21.904633Z","title":"Gpt-4 technical report","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.22271","last_updated":"2025-05-28T11:57:46Z","snapshot_observed_at":"2026-08-07T13:09:00.589520Z","submitted_at":"2025-05-28T11:57:46Z","title":"Test-Time Immunization: A Universal Defense Framework Against Jailbreaks for (Multimodal) Large Language Models","version":1},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-08-07T13:17:21.904633Z"},"links":{"cited_paper":"/paper/2303.08774","citing_paper":"/paper/2505.22271"},"observation_digest":"sha256:9fc27d5fc3d54c2e91acd8a0e2b88be7802a26002a7231481d68c856b61b472f","observation_id":"114fc22b-ea06-41dd-bf1f-25ae276fc8d0","resolution":{"observed_at":"2026-08-07T13:17:21.904633Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2411.07494","last_updated":"2024-11-12T02:44:49Z","snapshot_observed_at":"2026-08-08T08:23:55.394999Z","submitted_at":"2024-11-12T02:44:49Z","title":"Rapid Response: Mitigating LLM Jailbreaks with a Few Examples","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2411.07494","snapshot_observed_at":"2026-08-07T13:17:22.037860Z","title":"Rapid response: Mitigating llm jailbreaks with a few examples.arXiv preprint arXiv:2411.07494, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.22271","last_updated":"2025-05-28T11:57:46Z","snapshot_observed_at":"2026-08-07T13:09:00.589520Z","submitted_at":"2025-05-28T11:57:46Z","title":"Test-Time Immunization: A Universal Defense Framework Against Jailbreaks for (Multimodal) Large Language Models","version":1},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-08-07T13:17:22.037860Z"},"links":{"cited_paper":"/paper/2411.07494","citing_paper":"/paper/2505.22271"},"observation_digest":"sha256:b30a898dd9c5eb253bc39893deecd65a57b623162c0860dd71b29a916b53ccfe","observation_id":"cb30a0ee-b326-4202-967c-4c6538b87461","resolution":{"observed_at":"2026-08-07T13:17:22.037860Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2304.03277","last_updated":"2023-04-06T17:58:09Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2023-04-06T17:58:09Z","title":"Instruction Tuning with GPT-4","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2304.03277","snapshot_observed_at":"2026-08-07T13:17:22.099259Z","title":"Instruction tuning with gpt-4","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.22271","last_updated":"2025-05-28T11:57:46Z","snapshot_observed_at":"2026-08-07T13:09:00.589520Z","submitted_at":"2025-05-28T11:57:46Z","title":"Test-Time Immunization: A Universal Defense Framework Against Jailbreaks for (Multimodal) Large Language Models","version":1},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-08-07T13:17:22.099259Z"},"links":{"cited_paper":"/paper/2304.03277","citing_paper":"/paper/2505.22271"},"observation_digest":"sha256:f8a35e4ea217e44e07bae047e8dbc3ebad247b1387f4143aadc2d34e60a5ae1a","observation_id":"e881e95e-9ce6-4fbb-bec8-4cd8c8fb43df","resolution":{"observed_at":"2026-08-07T13:17:22.099259Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:17:29.447915Z","title":"Llm self defense: By self examination, llms know they are being tricked","venue":null,"work_id":"cff8b060-90e2-4b24-8612-3be9d7644a1d","year":2024},"citing_paper":{"arxiv_id":"2505.22271","last_updated":"2025-05-28T11:57:46Z","snapshot_observed_at":"2026-08-07T13:09:00.589520Z","submitted_at":"2025-05-28T11:57:46Z","title":"Test-Time Immunization: A Universal Defense Framework Against Jailbreaks for (Multimodal) Large Language Models","version":1},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-08-07T13:17:22.205834Z"},"links":{"citing_paper":"/paper/2505.22271"},"observation_digest":"sha256:0219eb974bdc8ee285da2a7353cbcb8aa0a9af49b9fdd72aac060bb10c6a3db6","observation_id":"a402bbf3-7b33-4adc-81cf-cdebf6a9d88b","resolution":{"observed_at":"2026-08-07T13:17:29.519521Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:17:29.288993Z","title":"Mllm-protector: Ensuring mllm’s safety without hurting performance.Proc","venue":null,"work_id":"375a18b8-0d97-487c-9ab3-f214b7c2aa3a","year":2024},"citing_paper":{"arxiv_id":"2505.22271","last_updated":"2025-05-28T11:57:46Z","snapshot_observed_at":"2026-08-07T13:09:00.589520Z","submitted_at":"2025-05-28T11:57:46Z","title":"Test-Time Immunization: A Universal Defense Framework Against Jailbreaks for (Multimodal) Large Language Models","version":1},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-08-07T13:17:22.352340Z"},"links":{"citing_paper":"/paper/2505.22271"},"observation_digest":"sha256:2aee0db9ea4b925bd9346034f4134de49dfbd5f4b7a99f716727848cda731e5b","observation_id":"3455ac16-09e2-4e3f-ab96-c22cdccbcb4c","resolution":{"observed_at":"2026-08-07T13:17:29.371293Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:17:29.120498Z","title":"Visual adversarial examples jailbreak aligned large language models","venue":null,"work_id":"091fde4f-3658-4322-82db-8f94b727a25f","year":2024},"citing_paper":{"arxiv_id":"2505.22271","last_updated":"2025-05-28T11:57:46Z","snapshot_observed_at":"2026-08-07T13:09:00.589520Z","submitted_at":"2025-05-28T11:57:46Z","title":"Test-Time Immunization: A Universal Defense Framework Against Jailbreaks for (Multimodal) Large Language Models","version":1},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-08-07T13:17:22.498989Z"},"links":{"citing_paper":"/paper/2505.22271"},"observation_digest":"sha256:4470813f8aef48e58659b10426afdb2821dd254f7a81c6fc6610e7140f0fe95d","observation_id":"79190684-5be4-426e-ae99-3203d733c65a","resolution":{"observed_at":"2026-08-07T13:17:29.226614Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:17:22.646829Z","title":"Improving language understanding by generative pre-training","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2505.22271","last_updated":"2025-05-28T11:57:46Z","snapshot_observed_at":"2026-08-07T13:09:00.589520Z","submitted_at":"2025-05-28T11:57:46Z","title":"Test-Time Immunization: A Universal Defense Framework Against Jailbreaks for (Multimodal) Large Language Models","version":1},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-08-07T13:17:22.646829Z"},"links":{"citing_paper":"/paper/2505.22271"},"observation_digest":"sha256:6fbe1cfdfdb5e753b16bd64bfffb142327b59e3e313d1824f85927e58de13c16","observation_id":"167eb778-99ee-4038-858d-aa63acb0cbf6","resolution":{"observed_at":"2026-08-07T13:17:22.646829Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:17:28.923056Z","title":"High-resolution image synthesis with latent diffusion models","venue":null,"work_id":"53265679-c394-4a43-8f0e-77f27661979e","year":2022},"citing_paper":{"arxiv_id":"2505.22271","last_updated":"2025-05-28T11:57:46Z","snapshot_observed_at":"2026-08-07T13:09:00.589520Z","submitted_at":"2025-05-28T11:57:46Z","title":"Test-Time Immunization: A Universal Defense Framework Against Jailbreaks for (Multimodal) Large Language Models","version":1},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-08-07T13:17:22.791835Z"},"links":{"citing_paper":"/paper/2505.22271"},"observation_digest":"sha256:9d5ee7f1f6d5dfa9b8ddcc1b4da0d65312dbd15ddb986f81eb9ce89fc46bb830","observation_id":"62efe873-765e-45cf-b857-39db2e329bc6","resolution":{"observed_at":"2026-08-07T13:17:28.993222Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2401.06030","last_updated":"2025-02-16T07:54:35Z","snapshot_observed_at":"2026-07-06T17:14:24.413664Z","submitted_at":"2024-01-11T16:42:10Z","title":"Protecting Model Adaptation from Trojans in the Unlabeled Data","version":2},"cited_work":{"arxiv_id":"2401.06030","doi":null,"metadata_source":"pith","pith_arxiv_id":"2401.06030","snapshot_observed_at":"2026-08-07T13:17:26.140989Z","title":"Protecting Model Adaptation from Trojans in the Unlabeled Data","venue":"cs.CR","work_id":"1f459fc3-884d-463a-92fd-e8c13f2c4255","year":2024},"citing_paper":{"arxiv_id":"2505.22271","last_updated":"2025-05-28T11:57:46Z","snapshot_observed_at":"2026-08-07T13:09:00.589520Z","submitted_at":"2025-05-28T11:57:46Z","title":"Test-Time Immunization: A Universal Defense Framework Against Jailbreaks for (Multimodal) Large Language Models","version":1},"reference_index":36,"source":"pdf_text","source_observed_at":"2026-08-07T13:17:22.922491Z"},"links":{"cited_paper":"/paper/2401.06030","citing_paper":"/paper/2505.22271"},"observation_digest":"sha256:0ae0ff52191623425556fa096d0a4a12bc0dde50788122c6a208476fe745b4c8","observation_id":"c8c15d46-d490-4f00-b15e-6831a2b9fa64","resolution":{"observed_at":"2026-08-07T13:17:26.238790Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:17:28.728165Z","title":"Learning to summarize with human feedback","venue":null,"work_id":"faa59ba3-7a62-4664-8085-e8c2aeb223f5","year":2020},"citing_paper":{"arxiv_id":"2505.22271","last_updated":"2025-05-28T11:57:46Z","snapshot_observed_at":"2026-08-07T13:09:00.589520Z","submitted_at":"2025-05-28T11:57:46Z","title":"Test-Time Immunization: A Universal Defense Framework Against Jailbreaks for (Multimodal) Large Language Models","version":1},"reference_index":37,"source":"pdf_text","source_observed_at":"2026-08-07T13:17:23.111377Z"},"links":{"citing_paper":"/paper/2505.22271"},"observation_digest":"sha256:4177977de662fbbd1cefa741d9bc2335e34d517829fe0427ba73017699e714db","observation_id":"712d64e6-8dba-4ac6-b879-9432bcf405f0","resolution":{"observed_at":"2026-08-07T13:17:28.789095Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:17:23.236378Z","title":"Measuring the accuracy of diagnostic systems.Science, 240(4857):1285–1293, 1988","venue":null,"work_id":null,"year":1988},"citing_paper":{"arxiv_id":"2505.22271","last_updated":"2025-05-28T11:57:46Z","snapshot_observed_at":"2026-08-07T13:09:00.589520Z","submitted_at":"2025-05-28T11:57:46Z","title":"Test-Time Immunization: A Universal Defense Framework Against Jailbreaks for (Multimodal) Large Language Models","version":1},"reference_index":38,"source":"pdf_text","source_observed_at":"2026-08-07T13:17:23.236378Z"},"links":{"citing_paper":"/paper/2505.22271"},"observation_digest":"sha256:a20f0a39ebc26c715eec5bdb7bcd2c5376fdca5248f515e827f9b6755996d7a3","observation_id":"78fe64cb-4df1-4848-8b0b-ecd21f5ca6ab","resolution":{"observed_at":"2026-08-07T13:17:23.236378Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2312.11805","last_updated":"2025-05-09T21:04:06Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2023-12-19T02:39:27Z","title":"Gemini: A Family of Highly Capable Multimodal Models","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2312.11805","snapshot_observed_at":"2026-08-07T13:17:23.436727Z","title":"Gemini: a family of highly capable multimodal models.arXiv preprint arXiv:2312.11805, 2023","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.22271","last_updated":"2025-05-28T11:57:46Z","snapshot_observed_at":"2026-08-07T13:09:00.589520Z","submitted_at":"2025-05-28T11:57:46Z","title":"Test-Time Immunization: A Universal Defense Framework Against Jailbreaks for (Multimodal) Large Language Models","version":1},"reference_index":39,"source":"pdf_text","source_observed_at":"2026-08-07T13:17:23.436727Z"},"links":{"cited_paper":"/paper/2312.11805","citing_paper":"/paper/2505.22271"},"observation_digest":"sha256:3b3d1efac013c4b4f798942a8c3f7c9ec44180f1f26d7395ce6f9f86e5b1ba92","observation_id":"0170707d-2eee-4bc2-9dd7-41195eac145e","resolution":{"observed_at":"2026-08-07T13:17:23.436727Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2307.09288","last_updated":"2023-07-19T17:08:59Z","snapshot_observed_at":"2026-08-07T12:56:43.323460Z","submitted_at":"2023-07-18T14:31:57Z","title":"Llama 2: Open Foundation and Fine-Tuned Chat Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2307.09288","snapshot_observed_at":"2026-08-07T13:17:23.623355Z","title":"Llama 2: Open foundation and fine-tuned chat models.arXiv preprint arXiv:2307.09288, 2023","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.22271","last_updated":"2025-05-28T11:57:46Z","snapshot_observed_at":"2026-08-07T13:09:00.589520Z","submitted_at":"2025-05-28T11:57:46Z","title":"Test-Time Immunization: A Universal Defense Framework Against Jailbreaks for (Multimodal) Large Language Models","version":1},"reference_index":40,"source":"pdf_text","source_observed_at":"2026-08-07T13:17:23.623355Z"},"links":{"cited_paper":"/paper/2307.09288","citing_paper":"/paper/2505.22271"},"observation_digest":"sha256:6637b54b7d76864b1f3fc47dbc89577506dd5d70ec9fd2615e738e8267758493","observation_id":"22d51830-12ec-482c-bd20-d75863969f64","resolution":{"observed_at":"2026-08-07T13:17:23.623355Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:17:28.529532Z","title":"Tent: Fully test-time adaptation by entropy minimization","venue":null,"work_id":"92707ed3-198e-4bfa-9ac1-cc706e1dfac6","year":2021},"citing_paper":{"arxiv_id":"2505.22271","last_updated":"2025-05-28T11:57:46Z","snapshot_observed_at":"2026-08-07T13:09:00.589520Z","submitted_at":"2025-05-28T11:57:46Z","title":"Test-Time Immunization: A Universal Defense Framework Against Jailbreaks for (Multimodal) Large Language Models","version":1},"reference_index":41,"source":"pdf_text","source_observed_at":"2026-08-07T13:17:23.739463Z"},"links":{"citing_paper":"/paper/2505.22271"},"observation_digest":"sha256:3ab1e7c2f07b34c91e533c6a3a3ce000a9840948cc3daf5e87d6048e14d774e2","observation_id":"03373f95-d0b4-4e6e-a721-de326268dd8a","resolution":{"observed_at":"2026-08-07T13:17:28.596615Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2504.10000","last_updated":"2025-04-14T09:03:51Z","snapshot_observed_at":"2026-08-07T16:05:58.881495Z","submitted_at":"2025-04-14T09:03:51Z","title":"Do We Really Need Curated Malicious Data for Safety Alignment in Multi-modal Large Language Models?","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2504.10000","snapshot_observed_at":"2026-08-07T13:17:23.839067Z","title":"Do we really need curated malicious data for safety alignment in multi-modal large language models?arXiv preprint arXiv:2504.10000, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2505.22271","last_updated":"2025-05-28T11:57:46Z","snapshot_observed_at":"2026-08-07T13:09:00.589520Z","submitted_at":"2025-05-28T11:57:46Z","title":"Test-Time Immunization: A Universal Defense Framework Against Jailbreaks for (Multimodal) Large Language Models","version":1},"reference_index":42,"source":"pdf_text","source_observed_at":"2026-08-07T13:17:23.839067Z"},"links":{"cited_paper":"/paper/2504.10000","citing_paper":"/paper/2505.22271"},"observation_digest":"sha256:a590624573360d0172d99a09f3738069034ab3823b8bf300948305537d034e27","observation_id":"7cdfaab2-b3b9-4dd1-8864-4e0ee71cfc06","resolution":{"observed_at":"2026-08-07T13:17:23.839067Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:17:28.272762Z","title":"Defending llms against jailbreaking attacks via backtranslation","venue":null,"work_id":"b7b8b6a9-1773-4d21-8527-88210b3ed252","year":2024},"citing_paper":{"arxiv_id":"2505.22271","last_updated":"2025-05-28T11:57:46Z","snapshot_observed_at":"2026-08-07T13:09:00.589520Z","submitted_at":"2025-05-28T11:57:46Z","title":"Test-Time Immunization: A Universal Defense Framework Against Jailbreaks for (Multimodal) Large Language Models","version":1},"reference_index":43,"source":"pdf_text","source_observed_at":"2026-08-07T13:17:23.937944Z"},"links":{"citing_paper":"/paper/2505.22271"},"observation_digest":"sha256:102ac8bb024ce9903b3d4fdf3d3ed597979ac38a6b9cf5a0d5b06ee3784005ca","observation_id":"89992326-ccef-4775-a9f8-511491b8817f","resolution":{"observed_at":"2026-08-07T13:17:28.389761Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:17:28.072111Z","title":"Adashield: Safeguarding multimodal large language models from structure-based attack via adaptive shield prompting","venue":null,"work_id":"cab9653d-575d-4c5e-b1c1-fcc85d8bd980","year":2024},"citing_paper":{"arxiv_id":"2505.22271","last_updated":"2025-05-28T11:57:46Z","snapshot_observed_at":"2026-08-07T13:09:00.589520Z","submitted_at":"2025-05-28T11:57:46Z","title":"Test-Time Immunization: A Universal Defense Framework Against Jailbreaks for (Multimodal) Large Language Models","version":1},"reference_index":44,"source":"pdf_text","source_observed_at":"2026-08-07T13:17:24.019287Z"},"links":{"citing_paper":"/paper/2505.22271"},"observation_digest":"sha256:61260bf45211c20acb6d3532e7dbae7079e011cb0873cec8f03cf4075b166670","observation_id":"06907291-a297-44f6-9858-e073b879b825","resolution":{"observed_at":"2026-08-07T13:17:28.160634Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2310.06387","last_updated":"2024-05-25T07:01:15Z","snapshot_observed_at":"2026-08-06T13:25:52.403871Z","submitted_at":"2023-10-10T07:50:29Z","title":"Jailbreak and Guard Aligned Language Models with Only Few In-Context Demonstrations","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2310.06387","snapshot_observed_at":"2026-08-07T13:17:24.102566Z","title":"Jailbreak and guard aligned language models with only few in-context demonstrations.arXiv preprint arXiv:2310.06387, 2023","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.22271","last_updated":"2025-05-28T11:57:46Z","snapshot_observed_at":"2026-08-07T13:09:00.589520Z","submitted_at":"2025-05-28T11:57:46Z","title":"Test-Time Immunization: A Universal Defense Framework Against Jailbreaks for (Multimodal) Large Language Models","version":1},"reference_index":45,"source":"pdf_text","source_observed_at":"2026-08-07T13:17:24.102566Z"},"links":{"cited_paper":"/paper/2310.06387","citing_paper":"/paper/2505.22271"},"observation_digest":"sha256:114d7b95a87bfc93f2d3ef8ea8cbcf0936d71697288402482d728a0a48d94789","observation_id":"73d2de4a-8bd0-44b0-b6e4-7b1dec2610c8","resolution":{"observed_at":"2026-08-07T13:17:24.102566Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:17:24.264935Z","title":"Defending chatgpt against jailbreak attack via self-reminders.Nature Machine Intelligence, 5(12):1486–1496, 2023","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.22271","last_updated":"2025-05-28T11:57:46Z","snapshot_observed_at":"2026-08-07T13:09:00.589520Z","submitted_at":"2025-05-28T11:57:46Z","title":"Test-Time Immunization: A Universal Defense Framework Against Jailbreaks for (Multimodal) Large Language Models","version":1},"reference_index":46,"source":"pdf_text","source_observed_at":"2026-08-07T13:17:24.264935Z"},"links":{"citing_paper":"/paper/2505.22271"},"observation_digest":"sha256:77ada33aa0d87fbb55e119c59dc1fa711af4a817d89d853d3f8f6ffccc41f6d4","observation_id":"471dcb12-f247-4482-be11-f598d5a4218c","resolution":{"observed_at":"2026-08-07T13:17:24.264935Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:17:27.877306Z","title":"Gradsafe: Detecting jailbreak prompts for llms via safety-critical gradient analysis","venue":null,"work_id":"27de6806-009f-47ac-9dc5-2ae6254394c6","year":2024},"citing_paper":{"arxiv_id":"2505.22271","last_updated":"2025-05-28T11:57:46Z","snapshot_observed_at":"2026-08-07T13:09:00.589520Z","submitted_at":"2025-05-28T11:57:46Z","title":"Test-Time Immunization: A Universal Defense Framework Against Jailbreaks for (Multimodal) Large Language Models","version":1},"reference_index":47,"source":"pdf_text","source_observed_at":"2026-08-07T13:17:24.416405Z"},"links":{"citing_paper":"/paper/2505.22271"},"observation_digest":"sha256:58ed9624b2394bc5be014d8b514290c17e87494483110bc0a85a24d413ac40e4","observation_id":"cc86ef63-d0e6-426b-afdd-275cea67d226","resolution":{"observed_at":"2026-08-07T13:17:27.939953Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:17:27.738824Z","title":"Wizardlm: Empowering large pre-trained language models to follow complex instructions","venue":null,"work_id":"97965e10-72b0-4e60-a7ef-8c63dffd14c9","year":2024},"citing_paper":{"arxiv_id":"2505.22271","last_updated":"2025-05-28T11:57:46Z","snapshot_observed_at":"2026-08-07T13:09:00.589520Z","submitted_at":"2025-05-28T11:57:46Z","title":"Test-Time Immunization: A Universal Defense Framework Against Jailbreaks for (Multimodal) Large Language Models","version":1},"reference_index":48,"source":"pdf_text","source_observed_at":"2026-08-07T13:17:24.547046Z"},"links":{"citing_paper":"/paper/2505.22271"},"observation_digest":"sha256:ad7d9bb7dde0b91714a18bdeb5543de6029e186e29f14d80ff4feb7241d6cbf8","observation_id":"9ef5f3f6-8b65-46ac-a09b-3c2d6e8fde5a","resolution":{"observed_at":"2026-08-07T13:17:27.801491Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2407.04295","last_updated":"2024-08-30T11:57:47Z","snapshot_observed_at":"2026-08-04T23:34:13.332065Z","submitted_at":"2024-07-05T06:57:30Z","title":"Jailbreak Attacks and Defenses Against Large Language Models: A Survey","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2407.04295","snapshot_observed_at":"2026-08-07T13:17:24.669043Z","title":"Jailbreak attacks and defenses against large language models: A survey.arXiv preprint arXiv:2407.04295, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.22271","last_updated":"2025-05-28T11:57:46Z","snapshot_observed_at":"2026-08-07T13:09:00.589520Z","submitted_at":"2025-05-28T11:57:46Z","title":"Test-Time Immunization: A Universal Defense Framework Against Jailbreaks for (Multimodal) Large Language Models","version":1},"reference_index":49,"source":"pdf_text","source_observed_at":"2026-08-07T13:17:24.669043Z"},"links":{"cited_paper":"/paper/2407.04295","citing_paper":"/paper/2505.22271"},"observation_digest":"sha256:ff89004c86f502af1baab45ecc710ac43532ebcfc7f0b0ec61d164290a52b5a4","observation_id":"83b8baf3-1190-47cd-a8ea-3fbfb5515aac","resolution":{"observed_at":"2026-08-07T13:17:24.669043Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:17:27.534038Z","title":"Stamp: Outlier-aware test-time adaptation with stable memory replay","venue":null,"work_id":"c9d20fc0-dd81-42bb-b630-9619ddf2c305","year":2024},"citing_paper":{"arxiv_id":"2505.22271","last_updated":"2025-05-28T11:57:46Z","snapshot_observed_at":"2026-08-07T13:09:00.589520Z","submitted_at":"2025-05-28T11:57:46Z","title":"Test-Time Immunization: A Universal Defense Framework Against Jailbreaks for (Multimodal) Large Language Models","version":1},"reference_index":50,"source":"pdf_text","source_observed_at":"2026-08-07T13:17:24.753149Z"},"links":{"citing_paper":"/paper/2505.22271"},"observation_digest":"sha256:9d66b6abc8a4204665a6cf91ad32bde692ddae178fcf77a7d2a2cc33077b95fc","observation_id":"cd5f35cc-4ef6-4d18-91ea-2720e37edaf4","resolution":{"observed_at":"2026-08-07T13:17:27.641319Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:17:24.856171Z","title":"Instruction tuning for large language models: A survey.arXiv preprint arXiv:2308.10792, 2023","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.22271","last_updated":"2025-05-28T11:57:46Z","snapshot_observed_at":"2026-08-07T13:09:00.589520Z","submitted_at":"2025-05-28T11:57:46Z","title":"Test-Time Immunization: A Universal Defense Framework Against Jailbreaks for (Multimodal) Large Language Models","version":1},"reference_index":51,"source":"pdf_text","source_observed_at":"2026-08-07T13:17:24.856171Z"},"links":{"citing_paper":"/paper/2505.22271"},"observation_digest":"sha256:4f09675cf8072bca5fc449df29be315b1a09b4d7bbd2bac0dbd85fd4acefe396","observation_id":"b82128b5-df7b-4649-91c9-431c1e7cad3b","resolution":{"observed_at":"2026-08-07T13:17:24.856171Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2312.10766","last_updated":"2025-03-15T00:49:45Z","snapshot_observed_at":"2026-07-06T17:04:17.738921Z","submitted_at":"2023-12-17T17:02:14Z","title":"JailGuard: A Universal Detection Framework for LLM Prompt-based Attacks","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2312.10766","snapshot_observed_at":"2026-08-07T13:17:24.937849Z","title":"Jailguard: A universal detection framework for llm prompt-based attacks.arXiv preprint arXiv:2312.10766, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.22271","last_updated":"2025-05-28T11:57:46Z","snapshot_observed_at":"2026-08-07T13:09:00.589520Z","submitted_at":"2025-05-28T11:57:46Z","title":"Test-Time Immunization: A Universal Defense Framework Against Jailbreaks for (Multimodal) Large Language Models","version":1},"reference_index":52,"source":"pdf_text","source_observed_at":"2026-08-07T13:17:24.937849Z"},"links":{"cited_paper":"/paper/2312.10766","citing_paper":"/paper/2505.22271"},"observation_digest":"sha256:b2b0260065efc696d61d6c1cfdef7af5d2de288fb2176ca88a45276e2fed333d","observation_id":"ddb5be6a-e6e3-426e-8d88-ce0dd430be2c","resolution":{"observed_at":"2026-08-07T13:17:24.937849Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:17:27.353641Z","title":"Defending large language models against jailbreaking attacks through goal prioritization","venue":null,"work_id":"56b1be76-5575-4e16-b230-77647191446a","year":2024},"citing_paper":{"arxiv_id":"2505.22271","last_updated":"2025-05-28T11:57:46Z","snapshot_observed_at":"2026-08-07T13:09:00.589520Z","submitted_at":"2025-05-28T11:57:46Z","title":"Test-Time Immunization: A Universal Defense Framework Against Jailbreaks for (Multimodal) Large Language Models","version":1},"reference_index":53,"source":"pdf_text","source_observed_at":"2026-08-07T13:17:25.086670Z"},"links":{"citing_paper":"/paper/2505.22271"},"observation_digest":"sha256:ce8b3745bfd2c009c21ece5a42ec5fd10f36a9c147b4e5fd028ce9d04ad79442","observation_id":"f98d0ec3-61f0-41e7-a35c-283aa7e4c457","resolution":{"observed_at":"2026-08-07T13:17:27.421311Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:17:27.216486Z","title":"The first to know: How token distributions reveal hidden knowledge in large vision-language models? InProc","venue":null,"work_id":"55cce094-6621-451d-8ad5-5033c7784778","year":2024},"citing_paper":{"arxiv_id":"2505.22271","last_updated":"2025-05-28T11:57:46Z","snapshot_observed_at":"2026-08-07T13:09:00.589520Z","submitted_at":"2025-05-28T11:57:46Z","title":"Test-Time Immunization: A Universal Defense Framework Against Jailbreaks for (Multimodal) Large Language Models","version":1},"reference_index":54,"source":"pdf_text","source_observed_at":"2026-08-07T13:17:25.232714Z"},"links":{"citing_paper":"/paper/2505.22271"},"observation_digest":"sha256:1662694a6fed45a77bc22552a9bbcb34fcd7a08553837d9b942fec627a4a5f27","observation_id":"ac80896e-fa10-4990-a10f-6527abf9c6b1","resolution":{"observed_at":"2026-08-07T13:17:27.275094Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2303.18223","last_updated":"2026-03-18T05:34:39Z","snapshot_observed_at":"2026-08-06T23:27:24.356320Z","submitted_at":"2023-03-31T17:28:46Z","title":"A Survey of Large Language Models","version":19},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2303.18223","snapshot_observed_at":"2026-08-07T13:17:25.320167Z","title":"A survey of large language models.arXiv preprint arXiv:2303.18223, 2023","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.22271","last_updated":"2025-05-28T11:57:46Z","snapshot_observed_at":"2026-08-07T13:09:00.589520Z","submitted_at":"2025-05-28T11:57:46Z","title":"Test-Time Immunization: A Universal Defense Framework Against Jailbreaks for (Multimodal) Large Language Models","version":1},"reference_index":55,"source":"pdf_text","source_observed_at":"2026-08-07T13:17:25.320167Z"},"links":{"cited_paper":"/paper/2303.18223","citing_paper":"/paper/2505.22271"},"observation_digest":"sha256:af4d4bc747ca63fb7bd63339c66d33c0ec4974b2ae3730971e19daf1cdff7da3","observation_id":"1e8403bd-a55d-4ef7-9dc1-b40ee193785a","resolution":{"observed_at":"2026-08-07T13:17:25.320167Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:17:27.044139Z","title":"Improved few-shot jailbreaking can circumvent aligned language models and their defenses","venue":null,"work_id":"6a34b7d2-34cb-415e-b50d-8647e135977d","year":2024},"citing_paper":{"arxiv_id":"2505.22271","last_updated":"2025-05-28T11:57:46Z","snapshot_observed_at":"2026-08-07T13:09:00.589520Z","submitted_at":"2025-05-28T11:57:46Z","title":"Test-Time Immunization: A Universal Defense Framework Against Jailbreaks for (Multimodal) Large Language Models","version":1},"reference_index":56,"source":"pdf_text","source_observed_at":"2026-08-07T13:17:25.541068Z"},"links":{"citing_paper":"/paper/2505.22271"},"observation_digest":"sha256:f7da01589234ac6bd5ab23a5e96189f421b5b9ea85b74a6924756ebb1819177a","observation_id":"637246e7-529b-4d42-a374-0a774e2dfdf5","resolution":{"observed_at":"2026-08-07T13:17:27.138624Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:17:26.890559Z","title":"Minigpt-4: Enhancing vision- language understanding with advanced large language models","venue":null,"work_id":"c3d3f11f-bc4a-460c-bfd8-3c55387bea7b","year":2024},"citing_paper":{"arxiv_id":"2505.22271","last_updated":"2025-05-28T11:57:46Z","snapshot_observed_at":"2026-08-07T13:09:00.589520Z","submitted_at":"2025-05-28T11:57:46Z","title":"Test-Time Immunization: A Universal Defense Framework Against Jailbreaks for (Multimodal) Large Language Models","version":1},"reference_index":57,"source":"pdf_text","source_observed_at":"2026-08-07T13:17:25.663621Z"},"links":{"citing_paper":"/paper/2505.22271"},"observation_digest":"sha256:01e9eb7497753bc7ad141b60015a3c44cdd3a247e13496fa15aa88b421f07e6d","observation_id":"7cb6da9d-22c6-4b49-9033-1ef6acbb4384","resolution":{"observed_at":"2026-08-07T13:17:26.974341Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:17:26.758978Z","title":"Safety fine-tuning at (almost) no cost: A baseline for vision large language models","venue":null,"work_id":"64c6ffe0-d326-48de-998a-def63f374758","year":2024},"citing_paper":{"arxiv_id":"2505.22271","last_updated":"2025-05-28T11:57:46Z","snapshot_observed_at":"2026-08-07T13:09:00.589520Z","submitted_at":"2025-05-28T11:57:46Z","title":"Test-Time Immunization: A Universal Defense Framework Against Jailbreaks for (Multimodal) Large Language Models","version":1},"reference_index":58,"source":"pdf_text","source_observed_at":"2026-08-07T13:17:25.755330Z"},"links":{"citing_paper":"/paper/2505.22271"},"observation_digest":"sha256:9a6f8e463b77aabc371c22e22e70611335d3e2261891ef2f290236db9c093fe7","observation_id":"5039fe24-3486-46e2-b31e-07ae8f4a358b","resolution":{"observed_at":"2026-08-07T13:17:26.826571Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2307.15043","last_updated":"2023-12-20T20:48:57Z","snapshot_observed_at":"2026-07-06T15:59:23.019044Z","submitted_at":"2023-07-27T17:49:12Z","title":"Universal and Transferable Adversarial Attacks on Aligned Language Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2307.15043","snapshot_observed_at":"2026-08-07T13:17:25.808065Z","title":"Universal and transferable adversarial attacks on aligned language models.arXiv preprint arXiv:2307.15043, 2023","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.22271","last_updated":"2025-05-28T11:57:46Z","snapshot_observed_at":"2026-08-07T13:09:00.589520Z","submitted_at":"2025-05-28T11:57:46Z","title":"Test-Time Immunization: A Universal Defense Framework Against Jailbreaks for (Multimodal) Large Language Models","version":1},"reference_index":59,"source":"pdf_text","source_observed_at":"2026-08-07T13:17:25.808065Z"},"links":{"cited_paper":"/paper/2307.15043","citing_paper":"/paper/2505.22271"},"observation_digest":"sha256:616bf9450b8a3738b319b2958e3361cd4c7f6faf258ee4c54f86fe714d8db497","observation_id":"4461d1a0-d860-431a-91e7-0ce83f9ad5b6","resolution":{"observed_at":"2026-08-07T13:17:25.808065Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"paper":{"arxiv_id":"2505.22271","last_updated":"2025-05-28T11:57:46Z","latest_version":1,"primary_category":"cs.CR","snapshot_observed_at":"2026-08-07T13:09:00.589520Z","submitted_at":"2025-05-28T11:57:46Z","title":"Test-Time Immunization: A Universal Defense Framework Against Jailbreaks for (Multimodal) Large Language Models"},"reference_resolution":{"displayed":58,"state_counts":{"malformed_identifier":0,"metadata_mismatch":1,"parse_uncertain":0,"unresolved":26,"verified_exact":1,"verified_fuzzy":30},"total_outbound_references":58},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"thesis":"As of 9 August 2026, this Paper Citation Record lists 58 of 58 outbound references and 2 inbound Pith citation observations for arXiv:2505.22271."}