{"as_of":"2026-08-15T06:25:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:32ccccdf1655122a39f65fbb59b8d25f23461384999205395d4abe742abdc6c4","coverage":[{"denominator":44,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":44,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-05T15:19:28.814379Z","state":"measured"},{"denominator":44,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":44,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-14T06:32:32.682623+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2508.20038/citation-record","integrity":"/paper/2508.20038/integrity","json":"/paper/2508.20038/citation-record.json","paper":"/paper/2508.20038"},"outbound":[{"citation":{"cited_paper":{"arxiv_id":"2402.10571","last_updated":"2024-06-06T12:02:37Z","snapshot_observed_at":"2026-08-14T16:32:16.325631Z","submitted_at":"2024-02-16T10:55:38Z","title":"Direct Preference Optimization with an Offset","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.10571","snapshot_observed_at":"2026-08-05T15:19:28.641196Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2508.20038","last_updated":"2025-09-04T09:23:46Z","snapshot_observed_at":"2026-08-10T19:27:18.821848Z","submitted_at":"2025-08-27T16:44:03Z","title":"Forewarned is Forearmed: Pre-Synthesizing Jailbreak-like Instructions to Enhance LLM Safety Guardrail to Potential Attacks","version":3},"reference_index":1,"source":"arxiv_source","source_observed_at":"2026-08-05T15:19:28.641196Z"},"links":{"cited_paper":"/paper/2402.10571","citing_paper":"/paper/2508.20038"},"observation_digest":"sha256:13a351125c0746108c1e22724bf2314cef220d1f986e004c325ea2f2cb58abcf","observation_id":"7e6f84a1-65fd-4f01-a787-58d2bebc5535","resolution":{"observed_at":"2026-08-05T15:19:28.641196Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2204.05862","last_updated":"2022-04-12T15:02:38Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2022-04-12T15:02:38Z","title":"Training a Helpful and Harmless Assistant with Reinforcement Learning from Human Feedback","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2204.05862","snapshot_observed_at":"2026-08-05T15:19:28.646214Z","title":null,"venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2508.20038","last_updated":"2025-09-04T09:23:46Z","snapshot_observed_at":"2026-08-10T19:27:18.821848Z","submitted_at":"2025-08-27T16:44:03Z","title":"Forewarned is Forearmed: Pre-Synthesizing Jailbreak-like Instructions to Enhance LLM Safety Guardrail to Potential Attacks","version":3},"reference_index":2,"source":"arxiv_source","source_observed_at":"2026-08-05T15:19:28.646214Z"},"links":{"cited_paper":"/paper/2204.05862","citing_paper":"/paper/2508.20038"},"observation_digest":"sha256:0ee6b03603953ea8f4b966b6d69d127efe04fc0dfea858a1847a71fa74ced7b5","observation_id":"ef892cbf-bde9-4c5a-8ef9-2f80188d8105","resolution":{"observed_at":"2026-08-05T15:19:28.646214Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T15:19:29.789654Z","title":null,"venue":null,"work_id":"db1ebe49-8a77-4989-ab07-da0e5ce807c5","year":2024},"citing_paper":{"arxiv_id":"2508.20038","last_updated":"2025-09-04T09:23:46Z","snapshot_observed_at":"2026-08-10T19:27:18.821848Z","submitted_at":"2025-08-27T16:44:03Z","title":"Forewarned is Forearmed: Pre-Synthesizing Jailbreak-like Instructions to Enhance LLM Safety Guardrail to Potential Attacks","version":3},"reference_index":3,"source":"arxiv_source","source_observed_at":"2026-08-05T15:19:28.651203Z"},"links":{"citing_paper":"/paper/2508.20038"},"observation_digest":"sha256:fb48288c91d25457e1636fb7d531734b5383492d933bcf01003fdd909b4914ed","observation_id":"9d6dc929-3f96-4087-8c83-48d3029c3e63","resolution":{"observed_at":"2026-08-05T15:19:29.793358Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2312.02554","last_updated":"2024-02-26T08:51:03Z","snapshot_observed_at":"2026-08-13T05:09:47.821705Z","submitted_at":"2023-12-05T07:52:12Z","title":"ULMA: Unified Language Model Alignment with Human Demonstration and Point-wise Preference","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2312.02554","snapshot_observed_at":"2026-08-05T15:19:28.656097Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2508.20038","last_updated":"2025-09-04T09:23:46Z","snapshot_observed_at":"2026-08-10T19:27:18.821848Z","submitted_at":"2025-08-27T16:44:03Z","title":"Forewarned is Forearmed: Pre-Synthesizing Jailbreak-like Instructions to Enhance LLM Safety Guardrail to Potential Attacks","version":3},"reference_index":4,"source":"arxiv_source","source_observed_at":"2026-08-05T15:19:28.656097Z"},"links":{"cited_paper":"/paper/2312.02554","citing_paper":"/paper/2508.20038"},"observation_digest":"sha256:2721366d0e60375de5166089bc76ab834e18bcda9c9738161b90743331802da7","observation_id":"617ffb52-952f-4ae3-9449-1aab2fb698f9","resolution":{"observed_at":"2026-08-05T15:19:28.656097Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2310.08419","last_updated":"2024-07-18T18:24:57Z","snapshot_observed_at":"2026-08-12T12:29:45.113982Z","submitted_at":"2023-10-12T15:38:28Z","title":"Jailbreaking Black Box Large Language Models in Twenty Queries","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2310.08419","snapshot_observed_at":"2026-08-05T15:19:28.660442Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2508.20038","last_updated":"2025-09-04T09:23:46Z","snapshot_observed_at":"2026-08-10T19:27:18.821848Z","submitted_at":"2025-08-27T16:44:03Z","title":"Forewarned is Forearmed: Pre-Synthesizing Jailbreak-like Instructions to Enhance LLM Safety Guardrail to Potential Attacks","version":3},"reference_index":5,"source":"arxiv_source","source_observed_at":"2026-08-05T15:19:28.660442Z"},"links":{"cited_paper":"/paper/2310.08419","citing_paper":"/paper/2508.20038"},"observation_digest":"sha256:07b137493fb46965a042786682e8db4b98f8a96287024bb019b122925e137b5a","observation_id":"c14d437e-ca9f-43f9-b24e-48440fce7107","resolution":{"observed_at":"2026-08-05T15:19:28.660442Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T15:19:29.777587Z","title":null,"venue":null,"work_id":"6a131d77-83de-41ec-b2b5-2f0ecc3819ba","year":2024},"citing_paper":{"arxiv_id":"2508.20038","last_updated":"2025-09-04T09:23:46Z","snapshot_observed_at":"2026-08-10T19:27:18.821848Z","submitted_at":"2025-08-27T16:44:03Z","title":"Forewarned is Forearmed: Pre-Synthesizing Jailbreak-like Instructions to Enhance LLM Safety Guardrail to Potential Attacks","version":3},"reference_index":6,"source":"arxiv_source","source_observed_at":"2026-08-05T15:19:28.664931Z"},"links":{"citing_paper":"/paper/2508.20038"},"observation_digest":"sha256:9bc160e066d2170557c4dbd0fda83a4cb89d124fac34b4e11dbce8e97b66fcef","observation_id":"0f4e160a-f0c3-4206-a3ba-cf03b304b473","resolution":{"observed_at":"2026-08-05T15:19:29.781531Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"2502.11401","doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T15:19:29.618823Z","title":null,"venue":null,"work_id":"054842ae-f252-4ad7-a947-2e8cd135e7ff","year":2025},"citing_paper":{"arxiv_id":"2508.20038","last_updated":"2025-09-04T09:23:46Z","snapshot_observed_at":"2026-08-10T19:27:18.821848Z","submitted_at":"2025-08-27T16:44:03Z","title":"Forewarned is Forearmed: Pre-Synthesizing Jailbreak-like Instructions to Enhance LLM Safety Guardrail to Potential Attacks","version":3},"reference_index":7,"source":"arxiv_source","source_observed_at":"2026-08-05T15:19:28.669404Z"},"links":{"citing_paper":"/paper/2508.20038"},"observation_digest":"sha256:2f0de069c035676296524415456cf4ddb64a56990806e4a87f71dc5786e958d3","observation_id":"b675a94a-2ffe-4658-8030-c9def3fda105","resolution":{"observed_at":"2026-08-05T15:19:29.625256Z","resolver_source":"raw_fallback","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T15:19:29.766936Z","title":null,"venue":null,"work_id":"f3e28af9-738a-433b-a4e6-e213763110ad","year":2025},"citing_paper":{"arxiv_id":"2508.20038","last_updated":"2025-09-04T09:23:46Z","snapshot_observed_at":"2026-08-10T19:27:18.821848Z","submitted_at":"2025-08-27T16:44:03Z","title":"Forewarned is Forearmed: Pre-Synthesizing Jailbreak-like Instructions to Enhance LLM Safety Guardrail to Potential Attacks","version":3},"reference_index":8,"source":"arxiv_source","source_observed_at":"2026-08-05T15:19:28.673301Z"},"links":{"citing_paper":"/paper/2508.20038"},"observation_digest":"sha256:3cf20060ec9ad641fa2de86c5bba24007e323f77f4a74a7eda4c8d389c86c1a6","observation_id":"5eba7804-cb6e-46f6-9dc9-4a176cfb7faa","resolution":{"observed_at":"2026-08-05T15:19:29.770304Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T15:19:28.677217Z","title":null,"venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2508.20038","last_updated":"2025-09-04T09:23:46Z","snapshot_observed_at":"2026-08-10T19:27:18.821848Z","submitted_at":"2025-08-27T16:44:03Z","title":"Forewarned is Forearmed: Pre-Synthesizing Jailbreak-like Instructions to Enhance LLM Safety Guardrail to Potential Attacks","version":3},"reference_index":9,"source":"arxiv_source","source_observed_at":"2026-08-05T15:19:28.677217Z"},"links":{"citing_paper":"/paper/2508.20038"},"observation_digest":"sha256:95c08d37b50d5c55de76b251194a54161413cffaf61622db1b0c3e6935e012a6","observation_id":"811af571-9d65-4da9-867d-69d6d34d4487","resolution":{"observed_at":"2026-08-05T15:19:28.677217Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T15:19:28.681211Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2508.20038","last_updated":"2025-09-04T09:23:46Z","snapshot_observed_at":"2026-08-10T19:27:18.821848Z","submitted_at":"2025-08-27T16:44:03Z","title":"Forewarned is Forearmed: Pre-Synthesizing Jailbreak-like Instructions to Enhance LLM Safety Guardrail to Potential Attacks","version":3},"reference_index":10,"source":"arxiv_source","source_observed_at":"2026-08-05T15:19:28.681211Z"},"links":{"citing_paper":"/paper/2508.20038"},"observation_digest":"sha256:4e8f4d082dd2fa2d17c15f8720c294a1dea007196d510210208b3f92ea8801f1","observation_id":"fb3da8b2-f497-4c4a-90fb-687af3b93e3f","resolution":{"observed_at":"2026-08-05T15:19:28.681211Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T15:19:29.755678Z","title":null,"venue":null,"work_id":"74fdc1d4-8b6e-49b2-a789-af6dc3b4e539","year":2021},"citing_paper":{"arxiv_id":"2508.20038","last_updated":"2025-09-04T09:23:46Z","snapshot_observed_at":"2026-08-10T19:27:18.821848Z","submitted_at":"2025-08-27T16:44:03Z","title":"Forewarned is Forearmed: Pre-Synthesizing Jailbreak-like Instructions to Enhance LLM Safety Guardrail to Potential Attacks","version":3},"reference_index":11,"source":"arxiv_source","source_observed_at":"2026-08-05T15:19:28.685307Z"},"links":{"citing_paper":"/paper/2508.20038"},"observation_digest":"sha256:ea7adc2df63ec985a62e4094940f5b6184d2501ec35aeb10ddd51c9e0c98df79","observation_id":"022732cb-b560-4c95-aa0c-ca4b0fc95b66","resolution":{"observed_at":"2026-08-05T15:19:29.759722Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T15:19:28.689238Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2508.20038","last_updated":"2025-09-04T09:23:46Z","snapshot_observed_at":"2026-08-10T19:27:18.821848Z","submitted_at":"2025-08-27T16:44:03Z","title":"Forewarned is Forearmed: Pre-Synthesizing Jailbreak-like Instructions to Enhance LLM Safety Guardrail to Potential Attacks","version":3},"reference_index":12,"source":"arxiv_source","source_observed_at":"2026-08-05T15:19:28.689238Z"},"links":{"citing_paper":"/paper/2508.20038"},"observation_digest":"sha256:7c0ff59440f5c446b15b6e6af77abf9daa98ec581d7f8adeea4bf7a2f5a978f4","observation_id":"843cbe3e-46bb-4f23-8942-ef4b731d7094","resolution":{"observed_at":"2026-08-05T15:19:28.689238Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T15:19:28.692748Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2508.20038","last_updated":"2025-09-04T09:23:46Z","snapshot_observed_at":"2026-08-10T19:27:18.821848Z","submitted_at":"2025-08-27T16:44:03Z","title":"Forewarned is Forearmed: Pre-Synthesizing Jailbreak-like Instructions to Enhance LLM Safety Guardrail to Potential Attacks","version":3},"reference_index":13,"source":"arxiv_source","source_observed_at":"2026-08-05T15:19:28.692748Z"},"links":{"citing_paper":"/paper/2508.20038"},"observation_digest":"sha256:1c8f8b4bb4cb95b56d6a12e0d4d829bb499f80c1cc6c606419edff1cc11f7077","observation_id":"daefed55-12ed-4ed3-b39a-cc8ed705b706","resolution":{"observed_at":"2026-08-05T15:19:28.692748Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2309.00614","last_updated":"2023-09-04T17:47:36Z","snapshot_observed_at":"2026-07-06T16:13:23.343694Z","submitted_at":"2023-09-01T17:59:44Z","title":"Baseline Defenses for Adversarial Attacks Against Aligned Language Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2309.00614","snapshot_observed_at":"2026-08-05T15:19:28.696552Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2508.20038","last_updated":"2025-09-04T09:23:46Z","snapshot_observed_at":"2026-08-10T19:27:18.821848Z","submitted_at":"2025-08-27T16:44:03Z","title":"Forewarned is Forearmed: Pre-Synthesizing Jailbreak-like Instructions to Enhance LLM Safety Guardrail to Potential Attacks","version":3},"reference_index":14,"source":"arxiv_source","source_observed_at":"2026-08-05T15:19:28.696552Z"},"links":{"cited_paper":"/paper/2309.00614","citing_paper":"/paper/2508.20038"},"observation_digest":"sha256:00b1c1b6a2c80df40ea85696e2d5f3cb375eb189d755ccf9b75776949b244e18","observation_id":"ef76d0d3-efe5-4905-9b13-d1f24d506c9c","resolution":{"observed_at":"2026-08-05T15:19:28.696552Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2406.15513","last_updated":"2025-06-14T16:04:31Z","snapshot_observed_at":"2026-08-12T23:38:02.782103Z","submitted_at":"2024-06-20T18:37:36Z","title":"PKU-SafeRLHF: Towards Multi-Level Safety Alignment for LLMs with Human Preference","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2406.15513","snapshot_observed_at":"2026-08-05T15:19:28.700858Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2508.20038","last_updated":"2025-09-04T09:23:46Z","snapshot_observed_at":"2026-08-10T19:27:18.821848Z","submitted_at":"2025-08-27T16:44:03Z","title":"Forewarned is Forearmed: Pre-Synthesizing Jailbreak-like Instructions to Enhance LLM Safety Guardrail to Potential Attacks","version":3},"reference_index":15,"source":"arxiv_source","source_observed_at":"2026-08-05T15:19:28.700858Z"},"links":{"cited_paper":"/paper/2406.15513","citing_paper":"/paper/2508.20038"},"observation_digest":"sha256:50af243573c61cdf523d5634596cb75ca0ec8bf200c82d1aba1047061e92616e","observation_id":"eff3e40d-afc2-4c4a-adf1-c989463ac2dc","resolution":{"observed_at":"2026-08-05T15:19:28.700858Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T15:19:29.743693Z","title":null,"venue":null,"work_id":"0887defe-7e1e-4dcd-aba6-640d04665645","year":2025},"citing_paper":{"arxiv_id":"2508.20038","last_updated":"2025-09-04T09:23:46Z","snapshot_observed_at":"2026-08-10T19:27:18.821848Z","submitted_at":"2025-08-27T16:44:03Z","title":"Forewarned is Forearmed: Pre-Synthesizing Jailbreak-like Instructions to Enhance LLM Safety Guardrail to Potential Attacks","version":3},"reference_index":16,"source":"arxiv_source","source_observed_at":"2026-08-05T15:19:28.705240Z"},"links":{"citing_paper":"/paper/2508.20038"},"observation_digest":"sha256:f45407cf44fb13be8264f6fc5a2f7382e4824f560bccc7b8fdf1e5da26cf3974","observation_id":"f252829c-8855-4c3c-9e11-20c1c0d4cacb","resolution":{"observed_at":"2026-08-05T15:19:29.747874Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"document/1057951","doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T15:19:29.459406Z","title":null,"venue":null,"work_id":"ccb2a7d0-aa97-4408-98e4-1b04db793348","year":2024},"citing_paper":{"arxiv_id":"2508.20038","last_updated":"2025-09-04T09:23:46Z","snapshot_observed_at":"2026-08-10T19:27:18.821848Z","submitted_at":"2025-08-27T16:44:03Z","title":"Forewarned is Forearmed: Pre-Synthesizing Jailbreak-like Instructions to Enhance LLM Safety Guardrail to Potential Attacks","version":3},"reference_index":17,"source":"arxiv_source","source_observed_at":"2026-08-05T15:19:28.709087Z"},"links":{"citing_paper":"/paper/2508.20038"},"observation_digest":"sha256:0e0c3dc433952954f109e2619fcb715a05b777b3c80a9a04388be22852cd4f36","observation_id":"af3700e1-1ce8-4961-a47b-f1a96a777353","resolution":{"observed_at":"2026-08-05T15:19:29.465098Z","resolver_source":"raw_fallback","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2004.11362","last_updated":"2021-03-10T19:11:45Z","snapshot_observed_at":"2026-08-11T01:09:30.499096Z","submitted_at":"2020-04-23T17:58:56Z","title":"Supervised Contrastive Learning","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2004.11362","snapshot_observed_at":"2026-08-05T15:19:28.712707Z","title":null,"venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2508.20038","last_updated":"2025-09-04T09:23:46Z","snapshot_observed_at":"2026-08-10T19:27:18.821848Z","submitted_at":"2025-08-27T16:44:03Z","title":"Forewarned is Forearmed: Pre-Synthesizing Jailbreak-like Instructions to Enhance LLM Safety Guardrail to Potential Attacks","version":3},"reference_index":18,"source":"arxiv_source","source_observed_at":"2026-08-05T15:19:28.712707Z"},"links":{"cited_paper":"/paper/2004.11362","citing_paper":"/paper/2508.20038"},"observation_digest":"sha256:6a9ffaafec0290b57272ca964da2e686c7679595785a6c094c1406f9ca169acc","observation_id":"1076ec5f-f993-49d8-9474-ace95c265944","resolution":{"observed_at":"2026-08-05T15:19:28.712707Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T15:19:28.716587Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2508.20038","last_updated":"2025-09-04T09:23:46Z","snapshot_observed_at":"2026-08-10T19:27:18.821848Z","submitted_at":"2025-08-27T16:44:03Z","title":"Forewarned is Forearmed: Pre-Synthesizing Jailbreak-like Instructions to Enhance LLM Safety Guardrail to Potential Attacks","version":3},"reference_index":19,"source":"arxiv_source","source_observed_at":"2026-08-05T15:19:28.716587Z"},"links":{"citing_paper":"/paper/2508.20038"},"observation_digest":"sha256:ed3c794b0f7772056242f6f7989c1ae28cb78304b8cb40fd4354ad969b09da25","observation_id":"cd641562-a259-4e52-b0a9-94c29775de28","resolution":{"observed_at":"2026-08-05T15:19:28.716587Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T15:19:28.720121Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2508.20038","last_updated":"2025-09-04T09:23:46Z","snapshot_observed_at":"2026-08-10T19:27:18.821848Z","submitted_at":"2025-08-27T16:44:03Z","title":"Forewarned is Forearmed: Pre-Synthesizing Jailbreak-like Instructions to Enhance LLM Safety Guardrail to Potential Attacks","version":3},"reference_index":20,"source":"arxiv_source","source_observed_at":"2026-08-05T15:19:28.720121Z"},"links":{"citing_paper":"/paper/2508.20038"},"observation_digest":"sha256:33fcf86747f3da7174298ec6d22a0f83c0e0784ba21ee533db57733474d2bcba","observation_id":"54fb31f6-e31b-4aef-9079-8673f6c98b9d","resolution":{"observed_at":"2026-08-05T15:19:28.720121Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"6772.36613","doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T15:19:29.224911Z","title":null,"venue":null,"work_id":"163e2592-1fe7-4b2e-b680-e940cfd6fafe","year":2024},"citing_paper":{"arxiv_id":"2508.20038","last_updated":"2025-09-04T09:23:46Z","snapshot_observed_at":"2026-08-10T19:27:18.821848Z","submitted_at":"2025-08-27T16:44:03Z","title":"Forewarned is Forearmed: Pre-Synthesizing Jailbreak-like Instructions to Enhance LLM Safety Guardrail to Potential Attacks","version":3},"reference_index":21,"source":"arxiv_source","source_observed_at":"2026-08-05T15:19:28.723808Z"},"links":{"citing_paper":"/paper/2508.20038"},"observation_digest":"sha256:d3cb08b76e08a0e09dc38d938781f94c75c3836c536c7807554884e0659ceca3","observation_id":"f7c23206-f068-487b-96be-fa4bf45712ca","resolution":{"observed_at":"2026-08-05T15:19:29.229993Z","resolver_source":"raw_fallback","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2412.19437","last_updated":"2025-02-18T17:26:38Z","snapshot_observed_at":"2026-08-11T01:48:59.557045Z","submitted_at":"2024-12-27T04:03:16Z","title":"DeepSeek-V3 Technical Report","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2412.19437","snapshot_observed_at":"2026-08-05T15:19:28.727169Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2508.20038","last_updated":"2025-09-04T09:23:46Z","snapshot_observed_at":"2026-08-10T19:27:18.821848Z","submitted_at":"2025-08-27T16:44:03Z","title":"Forewarned is Forearmed: Pre-Synthesizing Jailbreak-like Instructions to Enhance LLM Safety Guardrail to Potential Attacks","version":3},"reference_index":22,"source":"arxiv_source","source_observed_at":"2026-08-05T15:19:28.727169Z"},"links":{"cited_paper":"/paper/2412.19437","citing_paper":"/paper/2508.20038"},"observation_digest":"sha256:39c09c2a61415d3ba60068af0b89dd2fcc45ea7ac15536ca79c0b028423507df","observation_id":"36dfed1b-9602-4f5e-aeb8-7b3b17d75527","resolution":{"observed_at":"2026-08-05T15:19:28.727169Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2406.06622","last_updated":"2024-06-07T15:37:15Z","snapshot_observed_at":"2026-08-12T23:47:46.663207Z","submitted_at":"2024-06-07T15:37:15Z","title":"Adversarial Tuning: Defending Against Jailbreak Attacks for LLMs","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2406.06622","snapshot_observed_at":"2026-08-05T15:19:28.731489Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2508.20038","last_updated":"2025-09-04T09:23:46Z","snapshot_observed_at":"2026-08-10T19:27:18.821848Z","submitted_at":"2025-08-27T16:44:03Z","title":"Forewarned is Forearmed: Pre-Synthesizing Jailbreak-like Instructions to Enhance LLM Safety Guardrail to Potential Attacks","version":3},"reference_index":23,"source":"arxiv_source","source_observed_at":"2026-08-05T15:19:28.731489Z"},"links":{"cited_paper":"/paper/2406.06622","citing_paper":"/paper/2508.20038"},"observation_digest":"sha256:6885641bf43f309bbffac6e6e804516586d2492d4cb97ea9bff6ec2b7cf9dfd4","observation_id":"616e88b1-a1f9-4592-a5f5-e82b15c21ac5","resolution":{"observed_at":"2026-08-05T15:19:28.731489Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T15:19:29.732185Z","title":null,"venue":null,"work_id":"28cfa849-95e0-40d4-a8b9-d136a2e632fa","year":2024},"citing_paper":{"arxiv_id":"2508.20038","last_updated":"2025-09-04T09:23:46Z","snapshot_observed_at":"2026-08-10T19:27:18.821848Z","submitted_at":"2025-08-27T16:44:03Z","title":"Forewarned is Forearmed: Pre-Synthesizing Jailbreak-like Instructions to Enhance LLM Safety Guardrail to Potential Attacks","version":3},"reference_index":24,"source":"arxiv_source","source_observed_at":"2026-08-05T15:19:28.735158Z"},"links":{"citing_paper":"/paper/2508.20038"},"observation_digest":"sha256:c3019ab4ce869d4d162aea6a53f32006049a56862f0185d01da87c14732b705d","observation_id":"45ef16a7-3573-4c1d-8fb1-f036e0f4a6d3","resolution":{"observed_at":"2026-08-05T15:19:29.736218Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1907.11692","last_updated":"2019-07-26T17:48:29Z","snapshot_observed_at":"2026-07-31T22:31:37.910868Z","submitted_at":"2019-07-26T17:48:29Z","title":"RoBERTa: A Robustly Optimized BERT Pretraining Approach","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1907.11692","snapshot_observed_at":"2026-08-05T15:19:28.738640Z","title":null,"venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2508.20038","last_updated":"2025-09-04T09:23:46Z","snapshot_observed_at":"2026-08-10T19:27:18.821848Z","submitted_at":"2025-08-27T16:44:03Z","title":"Forewarned is Forearmed: Pre-Synthesizing Jailbreak-like Instructions to Enhance LLM Safety Guardrail to Potential Attacks","version":3},"reference_index":25,"source":"arxiv_source","source_observed_at":"2026-08-05T15:19:28.738640Z"},"links":{"cited_paper":"/paper/1907.11692","citing_paper":"/paper/2508.20038"},"observation_digest":"sha256:e6cd2346a1caf190b62e3f4f6976f5ffe7f68ff553e0d009cbee6c7478a647d8","observation_id":"f138e933-bc9f-40bb-bbd0-8dcfb4070eb0","resolution":{"observed_at":"2026-08-05T15:19:28.738640Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2402.04249","last_updated":"2024-02-27T04:43:08Z","snapshot_observed_at":"2026-07-06T17:26:23.067923Z","submitted_at":"2024-02-06T18:59:08Z","title":"HarmBench: A Standardized Evaluation Framework for Automated Red Teaming and Robust Refusal","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.04249","snapshot_observed_at":"2026-08-05T15:19:28.742660Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2508.20038","last_updated":"2025-09-04T09:23:46Z","snapshot_observed_at":"2026-08-10T19:27:18.821848Z","submitted_at":"2025-08-27T16:44:03Z","title":"Forewarned is Forearmed: Pre-Synthesizing Jailbreak-like Instructions to Enhance LLM Safety Guardrail to Potential Attacks","version":3},"reference_index":26,"source":"arxiv_source","source_observed_at":"2026-08-05T15:19:28.742660Z"},"links":{"cited_paper":"/paper/2402.04249","citing_paper":"/paper/2508.20038"},"observation_digest":"sha256:81b0283713be3e055fa86b7451a1049ca47296915b877ef661c2515b6fb80cc1","observation_id":"f38a13fa-2f25-4bcf-b4a6-2e5c76468636","resolution":{"observed_at":"2026-08-05T15:19:28.742660Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2312.02119","last_updated":"2024-10-31T15:57:42Z","snapshot_observed_at":"2026-08-14T06:54:18.196537Z","submitted_at":"2023-12-04T18:49:23Z","title":"Tree of Attacks: Jailbreaking Black-Box LLMs Automatically","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2312.02119","snapshot_observed_at":"2026-08-05T15:19:28.746165Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2508.20038","last_updated":"2025-09-04T09:23:46Z","snapshot_observed_at":"2026-08-10T19:27:18.821848Z","submitted_at":"2025-08-27T16:44:03Z","title":"Forewarned is Forearmed: Pre-Synthesizing Jailbreak-like Instructions to Enhance LLM Safety Guardrail to Potential Attacks","version":3},"reference_index":27,"source":"arxiv_source","source_observed_at":"2026-08-05T15:19:28.746165Z"},"links":{"cited_paper":"/paper/2312.02119","citing_paper":"/paper/2508.20038"},"observation_digest":"sha256:a0e07ebdce0ca1c966c56ebedb0185dc2da3f991dc830370833e9f9d95005e8b","observation_id":"000fc949-f8a4-4dde-9c96-4963f18b1be9","resolution":{"observed_at":"2026-08-05T15:19:28.746165Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T15:19:28.750653Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2508.20038","last_updated":"2025-09-04T09:23:46Z","snapshot_observed_at":"2026-08-10T19:27:18.821848Z","submitted_at":"2025-08-27T16:44:03Z","title":"Forewarned is Forearmed: Pre-Synthesizing Jailbreak-like Instructions to Enhance LLM Safety Guardrail to Potential Attacks","version":3},"reference_index":28,"source":"arxiv_source","source_observed_at":"2026-08-05T15:19:28.750653Z"},"links":{"citing_paper":"/paper/2508.20038"},"observation_digest":"sha256:b0edc151f1f02e5f88dd725520b9db07791d774863ca66ac599a7dbeac3589c7","observation_id":"98c904c8-a753-4e02-9ace-20ecad6158d1","resolution":{"observed_at":"2026-08-05T15:19:28.750653Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T15:19:29.721142Z","title":null,"venue":null,"work_id":"4b5a07ab-1ad1-4574-8aee-7e45ef50025e","year":2025},"citing_paper":{"arxiv_id":"2508.20038","last_updated":"2025-09-04T09:23:46Z","snapshot_observed_at":"2026-08-10T19:27:18.821848Z","submitted_at":"2025-08-27T16:44:03Z","title":"Forewarned is Forearmed: Pre-Synthesizing Jailbreak-like Instructions to Enhance LLM Safety Guardrail to Potential Attacks","version":3},"reference_index":29,"source":"arxiv_source","source_observed_at":"2026-08-05T15:19:28.754659Z"},"links":{"citing_paper":"/paper/2508.20038"},"observation_digest":"sha256:28579a9d6fb50b71535bf0b54dd7cbed2ad718a67c8b31b220e52befe08054c9","observation_id":"5f97ef73-33e8-4c32-a8de-e024c9fbb6da","resolution":{"observed_at":"2026-08-05T15:19:29.724587Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T15:19:29.709377Z","title":null,"venue":null,"work_id":"90bd9328-2a4b-4dad-aa43-c14381b08324","year":2024},"citing_paper":{"arxiv_id":"2508.20038","last_updated":"2025-09-04T09:23:46Z","snapshot_observed_at":"2026-08-10T19:27:18.821848Z","submitted_at":"2025-08-27T16:44:03Z","title":"Forewarned is Forearmed: Pre-Synthesizing Jailbreak-like Instructions to Enhance LLM Safety Guardrail to Potential Attacks","version":3},"reference_index":30,"source":"arxiv_source","source_observed_at":"2026-08-05T15:19:28.758723Z"},"links":{"citing_paper":"/paper/2508.20038"},"observation_digest":"sha256:b997f856e7eadde9f682f3660467f8c3d6f4967bcc4811095d1318a0a7185edf","observation_id":"40236222-e3c0-4377-88e5-d21b2c8bc112","resolution":{"observed_at":"2026-08-05T15:19:29.713149Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2305.18290","last_updated":"2024-07-29T22:26:36Z","snapshot_observed_at":"2026-08-01T16:34:38.795326Z","submitted_at":"2023-05-29T17:57:46Z","title":"Direct Preference Optimization: Your Language Model is Secretly a Reward Model","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2305.18290","snapshot_observed_at":"2026-08-05T15:19:28.762892Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2508.20038","last_updated":"2025-09-04T09:23:46Z","snapshot_observed_at":"2026-08-10T19:27:18.821848Z","submitted_at":"2025-08-27T16:44:03Z","title":"Forewarned is Forearmed: Pre-Synthesizing Jailbreak-like Instructions to Enhance LLM Safety Guardrail to Potential Attacks","version":3},"reference_index":31,"source":"arxiv_source","source_observed_at":"2026-08-05T15:19:28.762892Z"},"links":{"cited_paper":"/paper/2305.18290","citing_paper":"/paper/2508.20038"},"observation_digest":"sha256:e7cc2e7f4d955387f8b8727fe3e3246b28e69d865e4f43e896177eb91bf5585f","observation_id":"23afb1a2-3ba7-4620-92d2-a9dd18021805","resolution":{"observed_at":"2026-08-05T15:19:28.762892Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2310.03684","last_updated":"2024-06-11T19:02:52Z","snapshot_observed_at":"2026-07-06T16:28:22.350574Z","submitted_at":"2023-10-05T17:01:53Z","title":"SmoothLLM: Defending Large Language Models Against Jailbreaking Attacks","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2310.03684","snapshot_observed_at":"2026-08-05T15:19:28.766914Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2508.20038","last_updated":"2025-09-04T09:23:46Z","snapshot_observed_at":"2026-08-10T19:27:18.821848Z","submitted_at":"2025-08-27T16:44:03Z","title":"Forewarned is Forearmed: Pre-Synthesizing Jailbreak-like Instructions to Enhance LLM Safety Guardrail to Potential Attacks","version":3},"reference_index":32,"source":"arxiv_source","source_observed_at":"2026-08-05T15:19:28.766914Z"},"links":{"cited_paper":"/paper/2310.03684","citing_paper":"/paper/2508.20038"},"observation_digest":"sha256:56819487688e56768069e4dd95cd2928b1fd829572e77e020a3d140c3c8e8623","observation_id":"6de3c6e4-cfdf-418d-9e6f-f1a922078406","resolution":{"observed_at":"2026-08-05T15:19:28.766914Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T15:19:29.697733Z","title":null,"venue":null,"work_id":"689fdd82-b4ef-4e2d-9298-7dd380cc0653","year":2008},"citing_paper":{"arxiv_id":"2508.20038","last_updated":"2025-09-04T09:23:46Z","snapshot_observed_at":"2026-08-10T19:27:18.821848Z","submitted_at":"2025-08-27T16:44:03Z","title":"Forewarned is Forearmed: Pre-Synthesizing Jailbreak-like Instructions to Enhance LLM Safety Guardrail to Potential Attacks","version":3},"reference_index":33,"source":"arxiv_source","source_observed_at":"2026-08-05T15:19:28.771185Z"},"links":{"citing_paper":"/paper/2508.20038"},"observation_digest":"sha256:397e6fdce0727a2ae5a4dafeb919c812aceb2e574e0d8790009afd397eebbb99","observation_id":"b30f6490-fc5b-4edd-b298-7b54abd65edd","resolution":{"observed_at":"2026-08-05T15:19:29.701926Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T15:19:28.775502Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2508.20038","last_updated":"2025-09-04T09:23:46Z","snapshot_observed_at":"2026-08-10T19:27:18.821848Z","submitted_at":"2025-08-27T16:44:03Z","title":"Forewarned is Forearmed: Pre-Synthesizing Jailbreak-like Instructions to Enhance LLM Safety Guardrail to Potential Attacks","version":3},"reference_index":34,"source":"arxiv_source","source_observed_at":"2026-08-05T15:19:28.775502Z"},"links":{"citing_paper":"/paper/2508.20038"},"observation_digest":"sha256:3dc0ef862e531d88af3200feb34d0d5ebf99cb1ac1b5471e248090a84d5d1c2d","observation_id":"4db9b81a-bfac-4662-a2f8-a252fcf8f2d3","resolution":{"observed_at":"2026-08-05T15:19:28.775502Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2307.02483","last_updated":"2023-07-05T17:58:10Z","snapshot_observed_at":"2026-08-08T18:11:45.725753Z","submitted_at":"2023-07-05T17:58:10Z","title":"Jailbroken: How Does LLM Safety Training Fail?","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2307.02483","snapshot_observed_at":"2026-08-05T15:19:28.779862Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2508.20038","last_updated":"2025-09-04T09:23:46Z","snapshot_observed_at":"2026-08-10T19:27:18.821848Z","submitted_at":"2025-08-27T16:44:03Z","title":"Forewarned is Forearmed: Pre-Synthesizing Jailbreak-like Instructions to Enhance LLM Safety Guardrail to Potential Attacks","version":3},"reference_index":35,"source":"arxiv_source","source_observed_at":"2026-08-05T15:19:28.779862Z"},"links":{"cited_paper":"/paper/2307.02483","citing_paper":"/paper/2508.20038"},"observation_digest":"sha256:aa51584e9bea0346039c5de4428fc18a131f95f4c02233ca8724017a99934b05","observation_id":"5f460ebd-8f81-453e-b5b2-d90c8fe82983","resolution":{"observed_at":"2026-08-05T15:19:28.779862Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2404.12038","last_updated":"2024-11-30T08:52:29Z","snapshot_observed_at":"2026-08-13T00:27:33.396327Z","submitted_at":"2024-04-18T09:46:25Z","title":"Uncovering Safety Risks of Large Language Models through Concept Activation Vector","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2404.12038","snapshot_observed_at":"2026-08-05T15:19:28.783558Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2508.20038","last_updated":"2025-09-04T09:23:46Z","snapshot_observed_at":"2026-08-10T19:27:18.821848Z","submitted_at":"2025-08-27T16:44:03Z","title":"Forewarned is Forearmed: Pre-Synthesizing Jailbreak-like Instructions to Enhance LLM Safety Guardrail to Potential Attacks","version":3},"reference_index":36,"source":"arxiv_source","source_observed_at":"2026-08-05T15:19:28.783558Z"},"links":{"cited_paper":"/paper/2404.12038","citing_paper":"/paper/2508.20038"},"observation_digest":"sha256:7f1c86bd0c0d437b7e38837b5cdb00843ac366316df5dc9adcd4a07afa991391","observation_id":"2b24c292-b1f9-4fc1-bc01-f5896cb04529","resolution":{"observed_at":"2026-08-05T15:19:28.783558Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":"10.24963/ijcai.2024/730","metadata_source":"openalex","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T05:30:23.456663Z","title":null,"venue":null,"work_id":"3e1caee2-4222-49d7-a6e2-05348d1bf6ff","year":2024},"citing_paper":{"arxiv_id":"2508.20038","last_updated":"2025-09-04T09:23:46Z","snapshot_observed_at":"2026-08-10T19:27:18.821848Z","submitted_at":"2025-08-27T16:44:03Z","title":"Forewarned is Forearmed: Pre-Synthesizing Jailbreak-like Instructions to Enhance LLM Safety Guardrail to Potential Attacks","version":3},"reference_index":37,"source":"arxiv_source","source_observed_at":"2026-08-05T15:19:28.787397Z"},"links":{"citing_paper":"/paper/2508.20038"},"observation_digest":"sha256:c8d9de99ca7fe43a393dc6cf6acfb39dbb9b6eaa3d3b7fee7c7198edcffe8929","observation_id":"902e9ebf-a017-4d43-b062-c241551f3f90","resolution":{"observed_at":"2026-08-05T15:19:28.855833Z","resolver_source":"doi","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2412.15115","last_updated":"2025-01-03T02:18:21Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-12-19T17:56:09Z","title":"Qwen2.5 Technical Report","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2412.15115","snapshot_observed_at":"2026-08-05T15:19:28.791023Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2508.20038","last_updated":"2025-09-04T09:23:46Z","snapshot_observed_at":"2026-08-10T19:27:18.821848Z","submitted_at":"2025-08-27T16:44:03Z","title":"Forewarned is Forearmed: Pre-Synthesizing Jailbreak-like Instructions to Enhance LLM Safety Guardrail to Potential Attacks","version":3},"reference_index":38,"source":"arxiv_source","source_observed_at":"2026-08-05T15:19:28.791023Z"},"links":{"cited_paper":"/paper/2412.15115","citing_paper":"/paper/2508.20038"},"observation_digest":"sha256:55bbd76c02ae5a05a3878397f7b1f0bf71ef3c91b780bc4dbcb214cf60e1a841","observation_id":"112d6b96-b5bd-4791-9257-6f1725a473b3","resolution":{"observed_at":"2026-08-05T15:19:28.791023Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T15:19:28.794602Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2508.20038","last_updated":"2025-09-04T09:23:46Z","snapshot_observed_at":"2026-08-10T19:27:18.821848Z","submitted_at":"2025-08-27T16:44:03Z","title":"Forewarned is Forearmed: Pre-Synthesizing Jailbreak-like Instructions to Enhance LLM Safety Guardrail to Potential Attacks","version":3},"reference_index":39,"source":"arxiv_source","source_observed_at":"2026-08-05T15:19:28.794602Z"},"links":{"citing_paper":"/paper/2508.20038"},"observation_digest":"sha256:fac881b337b96b24bcf51b9afdb5adbbde7da74fc0a858fcbb9fb119351bcda9","observation_id":"f6e6a509-9d8a-47d5-8190-d6016029608e","resolution":{"observed_at":"2026-08-05T15:19:28.794602Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T15:19:29.686156Z","title":null,"venue":null,"work_id":"c1a77c11-be5c-403a-9cb5-5d1ff4bf217b","year":2023},"citing_paper":{"arxiv_id":"2508.20038","last_updated":"2025-09-04T09:23:46Z","snapshot_observed_at":"2026-08-10T19:27:18.821848Z","submitted_at":"2025-08-27T16:44:03Z","title":"Forewarned is Forearmed: Pre-Synthesizing Jailbreak-like Instructions to Enhance LLM Safety Guardrail to Potential Attacks","version":3},"reference_index":40,"source":"arxiv_source","source_observed_at":"2026-08-05T15:19:28.798062Z"},"links":{"citing_paper":"/paper/2508.20038"},"observation_digest":"sha256:73ef47de641bf1d6ea8451bb408bbedc06b47c0b257c28525f3ed12bb75f2881","observation_id":"560872f0-5bab-4dfe-a33e-7f0de0cf3cb1","resolution":{"observed_at":"2026-08-05T15:19:29.689875Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T15:19:29.673158Z","title":null,"venue":null,"work_id":"50c3bc33-2c28-4329-8499-c949f90338bf","year":2024},"citing_paper":{"arxiv_id":"2508.20038","last_updated":"2025-09-04T09:23:46Z","snapshot_observed_at":"2026-08-10T19:27:18.821848Z","submitted_at":"2025-08-27T16:44:03Z","title":"Forewarned is Forearmed: Pre-Synthesizing Jailbreak-like Instructions to Enhance LLM Safety Guardrail to Potential Attacks","version":3},"reference_index":41,"source":"arxiv_source","source_observed_at":"2026-08-05T15:19:28.801530Z"},"links":{"citing_paper":"/paper/2508.20038"},"observation_digest":"sha256:1d522fb1018e3e093fb2df6b3b6990e4eda116bb6d3cc0e51dd900901bd9cdc4","observation_id":"0d4b8050-2612-4d20-ad92-d2cc045099de","resolution":{"observed_at":"2026-08-05T15:19:29.676691Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2403.12171","last_updated":"2024-03-18T18:39:53Z","snapshot_observed_at":"2026-08-15T04:42:18.433471Z","submitted_at":"2024-03-18T18:39:53Z","title":"EasyJailbreak: A Unified Framework for Jailbreaking Large Language Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2403.12171","snapshot_observed_at":"2026-08-05T15:19:28.806156Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2508.20038","last_updated":"2025-09-04T09:23:46Z","snapshot_observed_at":"2026-08-10T19:27:18.821848Z","submitted_at":"2025-08-27T16:44:03Z","title":"Forewarned is Forearmed: Pre-Synthesizing Jailbreak-like Instructions to Enhance LLM Safety Guardrail to Potential Attacks","version":3},"reference_index":42,"source":"arxiv_source","source_observed_at":"2026-08-05T15:19:28.806156Z"},"links":{"cited_paper":"/paper/2403.12171","citing_paper":"/paper/2508.20038"},"observation_digest":"sha256:ec2c70f207b57ebc80ea1361cbedc79c9817b84e44ff8ff99cc1948968e437bb","observation_id":"9acaafa4-1e44-400b-8edb-87a8f31d9f3d","resolution":{"observed_at":"2026-08-05T15:19:28.806156Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T15:19:28.810265Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2508.20038","last_updated":"2025-09-04T09:23:46Z","snapshot_observed_at":"2026-08-10T19:27:18.821848Z","submitted_at":"2025-08-27T16:44:03Z","title":"Forewarned is Forearmed: Pre-Synthesizing Jailbreak-like Instructions to Enhance LLM Safety Guardrail to Potential Attacks","version":3},"reference_index":43,"source":"arxiv_source","source_observed_at":"2026-08-05T15:19:28.810265Z"},"links":{"citing_paper":"/paper/2508.20038"},"observation_digest":"sha256:6a43cdd94c048ecf98fd11d9b1bdae192c9b547e6797bc836785ca0b3729e927","observation_id":"e530c920-bbbb-4d95-b264-b19338b4e739","resolution":{"observed_at":"2026-08-05T15:19:28.810265Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2307.15043","last_updated":"2023-12-20T20:48:57Z","snapshot_observed_at":"2026-08-12T09:06:50.363435Z","submitted_at":"2023-07-27T17:49:12Z","title":"Universal and Transferable Adversarial Attacks on Aligned Language Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2307.15043","snapshot_observed_at":"2026-08-05T15:19:28.814379Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2508.20038","last_updated":"2025-09-04T09:23:46Z","snapshot_observed_at":"2026-08-10T19:27:18.821848Z","submitted_at":"2025-08-27T16:44:03Z","title":"Forewarned is Forearmed: Pre-Synthesizing Jailbreak-like Instructions to Enhance LLM Safety Guardrail to Potential Attacks","version":3},"reference_index":44,"source":"arxiv_source","source_observed_at":"2026-08-05T15:19:28.814379Z"},"links":{"cited_paper":"/paper/2307.15043","citing_paper":"/paper/2508.20038"},"observation_digest":"sha256:18d359bc52f2a16f8d4a95d8615c76b6f2265e0b6b06ea604cd319d74e4b106f","observation_id":"3f49e195-943b-43bf-ad68-63dee9888f5f","resolution":{"observed_at":"2026-08-05T15:19:28.814379Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"paper":{"arxiv_id":"2508.20038","last_updated":"2025-09-04T09:23:46Z","latest_version":3,"primary_category":"cs.CL","snapshot_observed_at":"2026-08-10T19:27:18.821848Z","submitted_at":"2025-08-27T16:44:03Z","title":"Forewarned is Forearmed: Pre-Synthesizing Jailbreak-like Instructions to Enhance LLM Safety Guardrail to Potential Attacks"},"reference_resolution":{"displayed":44,"state_counts":{"malformed_identifier":0,"metadata_mismatch":1,"parse_uncertain":0,"unresolved":40,"verified_exact":3,"verified_fuzzy":0},"total_outbound_references":44},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"thesis":"As of 15 August 2026, this Paper Citation Record lists 44 of 44 outbound references and 0 inbound Pith citation observations for arXiv:2508.20038."}