{"as_of":"2026-08-20T15:37:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:43b9a0b64afd71c5164b8f5c6532b234ed42cb2a7e978cd4d05802e11350e69e","coverage":[{"denominator":27,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":27,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-01T11:40:29.288152Z","state":"measured"},{"denominator":29,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":29,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-20T06:33:59.587034+00:00","state":"measured"},{"denominator":2,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":2,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-12T20:49:20.302614Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"pith","source_observed_at":"2026-08-06T10:46:11.686159Z","state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2607.19829","last_updated":"2026-07-22T07:08:59Z","snapshot_observed_at":"2026-08-11T08:08:11.528412Z","submitted_at":"2026-07-22T07:08:59Z","title":"DARWIN: Evolving Jailbreak Adversary and Guardrail for LLM Safety Evaluation and Protection","version":1},"cited_work":{"arxiv_id":"2607.19829","doi":null,"metadata_source":"pith","pith_arxiv_id":"2607.19829","snapshot_observed_at":"2026-08-06T10:46:11.686159Z","title":"DARWIN: Evolving Jailbreak Adversary and Guardrail for LLM Safety Evaluation and Protection","venue":"cs.CR","work_id":"89725139-467b-46c3-ae89-51df01ff6dfc","year":2026},"citing_paper":{"arxiv_id":"2608.05045","last_updated":"2026-08-05T16:55:59Z","snapshot_observed_at":"2026-08-18T04:55:47.009006Z","submitted_at":"2026-08-05T16:55:59Z","title":"Gradient Immunity: Null-Space Resistance to Malicious Fine-Tuning","version":1},"reference_index":97,"source":"arxiv_source","source_observed_at":"2026-08-06T10:46:10.892459Z"},"links":{"cited_paper":"/paper/2607.19829","citing_paper":"/paper/2608.05045"},"observation_digest":"sha256:459206af40fb4daff7a137a97cb168cfa24889b6f9b66510004a5882610bbcfb","observation_id":"afe0bdc5-8d00-441b-b918-89d842d108e4","resolution":{"observed_at":"2026-08-06T10:46:11.691488Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2607.19829","last_updated":"2026-07-22T07:08:59Z","snapshot_observed_at":"2026-08-11T08:08:11.528412Z","submitted_at":"2026-07-22T07:08:59Z","title":"DARWIN: Evolving Jailbreak Adversary and Guardrail for LLM Safety Evaluation and Protection","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2607.19829","snapshot_observed_at":"2026-08-12T20:49:20.302614Z","title":"InProceedings of the 2025 Inter- national Conference on Machine Learning, volume 267, 48439–48469","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2608.10621","last_updated":"2026-08-11T08:08:41Z","snapshot_observed_at":"2026-08-16T02:18:39.250163Z","submitted_at":"2026-08-11T08:08:41Z","title":"ProbGuard: Calibrated Safety Risk Estimation from LLM Output Distributions","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-12T20:49:20.302614Z"},"links":{"cited_paper":"/paper/2607.19829","citing_paper":"/paper/2608.10621"},"observation_digest":"sha256:c0b0343919c87f04e91d651bb846ebce4b195d398b8d52572aa26e6954b4757a","observation_id":"15258ecd-328c-47e5-99ee-d10dba8ba14f","resolution":{"observed_at":"2026-08-12T20:49:20.302614Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"links":{"evidence":"/evidence","html":"/paper/2607.19829/citation-record","integrity":"/paper/2607.19829/integrity","json":"/paper/2607.19829/citation-record.json","paper":"/paper/2607.19829"},"outbound":[{"citation":{"cited_paper":{"arxiv_id":"2310.08419","last_updated":"2024-07-18T18:24:57Z","snapshot_observed_at":"2026-08-16T13:08:51.920120Z","submitted_at":"2023-10-12T15:38:28Z","title":"Jailbreaking Black Box Large Language Models in Twenty Queries","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2310.08419","snapshot_observed_at":"2026-08-01T11:40:26.308203Z","title":"Jailbreakbench: An open robustness benchmark for jailbreaking large language models.Advances in Neural Information Processing Systems, 37:55005–55029, 2024a","venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2607.19829","last_updated":"2026-07-22T07:08:59Z","snapshot_observed_at":"2026-08-11T08:08:11.528412Z","submitted_at":"2026-07-22T07:08:59Z","title":"DARWIN: Evolving Jailbreak Adversary and Guardrail for LLM Safety Evaluation and Protection","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-01T11:40:26.308203Z"},"links":{"cited_paper":"/paper/2310.08419","citing_paper":"/paper/2607.19829"},"observation_digest":"sha256:83dc8c634f0075030bcd2c8b6b8980aa7ca40a24693a864af05253c16bf31690","observation_id":"0cd9fb51-16b4-4a21-9632-2539ec7881a4","resolution":{"observed_at":"2026-08-01T11:40:26.308203Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T11:40:26.702036Z","title":"Dynaguard: A dynamic guardian model with user-defined policies.arXiv preprint arXiv:2509.02563,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.19829","last_updated":"2026-07-22T07:08:59Z","snapshot_observed_at":"2026-08-11T08:08:11.528412Z","submitted_at":"2026-07-22T07:08:59Z","title":"DARWIN: Evolving Jailbreak Adversary and Guardrail for LLM Safety Evaluation and Protection","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-01T11:40:26.702036Z"},"links":{"citing_paper":"/paper/2607.19829"},"observation_digest":"sha256:b8b3f8c250dd521ed30ed63b3e7cbe1ecd682eb1a6e03b8797598f7c86cfd5c9","observation_id":"d88f9d01-4cc3-4048-a3cc-ab972bdb7c47","resolution":{"observed_at":"2026-08-01T11:40:26.702036Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T11:40:27.111834Z","title":"Toxicchat: Unveiling hidden challenges of toxicity detection in real-world user-ai conversation","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2607.19829","last_updated":"2026-07-22T07:08:59Z","snapshot_observed_at":"2026-08-11T08:08:11.528412Z","submitted_at":"2026-07-22T07:08:59Z","title":"DARWIN: Evolving Jailbreak Adversary and Guardrail for LLM Safety Evaluation and Protection","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-01T11:40:27.111834Z"},"links":{"citing_paper":"/paper/2607.19829"},"observation_digest":"sha256:52482502b7013669d6bd099e5f6474a8c27a91da1fb332bb04e47743ff66d965","observation_id":"10667c4e-b9a1-4623-8233-fb3168bb72d6","resolution":{"observed_at":"2026-08-01T11:40:27.111834Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T11:40:27.258662Z","title":"Autodan-turbo: A lifelong agent for strategy self-exploration to jailbreak llms","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.19829","last_updated":"2026-07-22T07:08:59Z","snapshot_observed_at":"2026-08-11T08:08:11.528412Z","submitted_at":"2026-07-22T07:08:59Z","title":"DARWIN: Evolving Jailbreak Adversary and Guardrail for LLM Safety Evaluation and Protection","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-01T11:40:27.258662Z"},"links":{"citing_paper":"/paper/2607.19829"},"observation_digest":"sha256:6b03ddeca403c086df3ea715d5dc714a1a22484460a46587a778d6edcfa19608","observation_id":"9490cd8a-54f1-426e-b140-c686b44f30d2","resolution":{"observed_at":"2026-08-01T11:40:27.258662Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2402.04249","last_updated":"2024-02-27T04:43:08Z","snapshot_observed_at":"2026-08-16T09:07:20.265665Z","submitted_at":"2024-02-06T18:59:08Z","title":"HarmBench: A Standardized Evaluation Framework for Automated Red Teaming and Robust Refusal","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.04249","snapshot_observed_at":"2026-08-01T11:40:27.294658Z","title":"Harmbench: A standardized evaluation framework for automated red teaming and robust refusal.arXiv preprint arXiv:2402.04249,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.19829","last_updated":"2026-07-22T07:08:59Z","snapshot_observed_at":"2026-08-11T08:08:11.528412Z","submitted_at":"2026-07-22T07:08:59Z","title":"DARWIN: Evolving Jailbreak Adversary and Guardrail for LLM Safety Evaluation and Protection","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-01T11:40:27.294658Z"},"links":{"cited_paper":"/paper/2402.04249","citing_paper":"/paper/2607.19829"},"observation_digest":"sha256:143534d44cb8afa28901f3b435f287b7b3cc38c6518d68d5e02dd19c12a24c8c","observation_id":"221abdd0-51f2-4066-af83-0b87d3abe50a","resolution":{"observed_at":"2026-08-01T11:40:27.294658Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T11:40:27.365443Z","title":"Can a suit of armor conduct elec- tricity? a new dataset for open book question answering","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2607.19829","last_updated":"2026-07-22T07:08:59Z","snapshot_observed_at":"2026-08-11T08:08:11.528412Z","submitted_at":"2026-07-22T07:08:59Z","title":"DARWIN: Evolving Jailbreak Adversary and Guardrail for LLM Safety Evaluation and Protection","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-01T11:40:27.365443Z"},"links":{"citing_paper":"/paper/2607.19829"},"observation_digest":"sha256:61e8f85bfe052b410d85a202ed0d15955662fb1a04f295e666e60185c10f0d24","observation_id":"7bee6b2c-cff6-44d5-870d-f6020aa95d81","resolution":{"observed_at":"2026-08-01T11:40:27.365443Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2412.07724","last_updated":"2024-12-16T20:27:36Z","snapshot_observed_at":"2026-08-14T13:29:11.901741Z","submitted_at":"2024-12-10T18:17:02Z","title":"Granite Guardian","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2412.07724","snapshot_observed_at":"2026-08-01T11:40:27.436778Z","title":"Granite guardian.arXiv preprint arXiv:2412.07724,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.19829","last_updated":"2026-07-22T07:08:59Z","snapshot_observed_at":"2026-08-11T08:08:11.528412Z","submitted_at":"2026-07-22T07:08:59Z","title":"DARWIN: Evolving Jailbreak Adversary and Guardrail for LLM Safety Evaluation and Protection","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-01T11:40:27.436778Z"},"links":{"cited_paper":"/paper/2412.07724","citing_paper":"/paper/2607.19829"},"observation_digest":"sha256:e9fb33e710b490f93b99b4001f6261461597cd47b23ec242068287319325d7de","observation_id":"854e725e-9c82-4c49-80bd-72bfce434bb3","resolution":{"observed_at":"2026-08-01T11:40:27.436778Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T11:40:27.527425Z","title":"Majic: Markovian adaptive jailbreaking via iterative composition of diverse innovative strategies","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2607.19829","last_updated":"2026-07-22T07:08:59Z","snapshot_observed_at":"2026-08-11T08:08:11.528412Z","submitted_at":"2026-07-22T07:08:59Z","title":"DARWIN: Evolving Jailbreak Adversary and Guardrail for LLM Safety Evaluation and Protection","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-01T11:40:27.527425Z"},"links":{"citing_paper":"/paper/2607.19829"},"observation_digest":"sha256:36ec2d1ee91ee60ed2488d1d529c4ebad7247aa64a04f074691b7b4ff82ef409","observation_id":"9b521d1e-c292-4b2c-9a38-8ad87089f048","resolution":{"observed_at":"2026-08-01T11:40:27.527425Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T11:40:27.612489Z","title":"Xstest: A test suite for identifying exaggerated safety behaviours in large language models","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.19829","last_updated":"2026-07-22T07:08:59Z","snapshot_observed_at":"2026-08-11T08:08:11.528412Z","submitted_at":"2026-07-22T07:08:59Z","title":"DARWIN: Evolving Jailbreak Adversary and Guardrail for LLM Safety Evaluation and Protection","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-01T11:40:27.612489Z"},"links":{"citing_paper":"/paper/2607.19829"},"observation_digest":"sha256:ced84e38cab8ffbc2150ade73290a078a304f0abbb7267427f561ed22a429442","observation_id":"c5533a15-3c8c-4db2-8cf6-0ce30afd0641","resolution":{"observed_at":"2026-08-01T11:40:27.612489Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T11:40:27.834194Z","title":"” do anything now”: Characterizing and evaluating in-the-wild jailbreak prompts on large language models","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.19829","last_updated":"2026-07-22T07:08:59Z","snapshot_observed_at":"2026-08-11T08:08:11.528412Z","submitted_at":"2026-07-22T07:08:59Z","title":"DARWIN: Evolving Jailbreak Adversary and Guardrail for LLM Safety Evaluation and Protection","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-01T11:40:27.834194Z"},"links":{"citing_paper":"/paper/2607.19829"},"observation_digest":"sha256:a0f463464d265016162dfd98c7fede822d4d4b5dea70252553676d20205b6f2a","observation_id":"6045229e-334d-45e2-9e93-a652524a5b4c","resolution":{"observed_at":"2026-08-01T11:40:27.834194Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2607.15081","last_updated":"2026-07-16T14:51:42Z","snapshot_observed_at":"2026-08-19T03:00:36.494628Z","submitted_at":"2026-07-16T14:51:42Z","title":"DataShield: Uncovering Risky Fine-Tuning Data Across LLMs Through Consensus Subspace Alignment","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2607.15081","snapshot_observed_at":"2026-08-01T11:40:27.995842Z","title":"Datashield: Uncovering risky fine-tuning data across llms through consensus subspace alignment.arXiv preprint arXiv:2607.15081,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.19829","last_updated":"2026-07-22T07:08:59Z","snapshot_observed_at":"2026-08-11T08:08:11.528412Z","submitted_at":"2026-07-22T07:08:59Z","title":"DARWIN: Evolving Jailbreak Adversary and Guardrail for LLM Safety Evaluation and Protection","version":1},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-01T11:40:27.995842Z"},"links":{"cited_paper":"/paper/2607.15081","citing_paper":"/paper/2607.19829"},"observation_digest":"sha256:3f491f02f800fbc238b98b9b1b3aac5df05fd7fe18ea478a96f691fa2e199ae0","observation_id":"8970f135-f645-4ec0-b2f6-e59684d0f5b1","resolution":{"observed_at":"2026-08-01T11:40:27.995842Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T11:40:28.214780Z","title":"Dynamic target attack.arXiv preprint arXiv:2510.02422,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.19829","last_updated":"2026-07-22T07:08:59Z","snapshot_observed_at":"2026-08-11T08:08:11.528412Z","submitted_at":"2026-07-22T07:08:59Z","title":"DARWIN: Evolving Jailbreak Adversary and Guardrail for LLM Safety Evaluation and Protection","version":1},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-01T11:40:28.214780Z"},"links":{"citing_paper":"/paper/2607.19829"},"observation_digest":"sha256:97ffd5e14f8f0a89e05ac3d0f0043c66627d32ff8f342ec6d7a81a15478bb497","observation_id":"d58ce2cc-fe83-43d2-b06f-990d925cb16b","resolution":{"observed_at":"2026-08-01T11:40:28.214780Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T11:40:28.396101Z","title":"Harmmetric eval: Benchmarking metrics and judges for llm harmfulness assessment.arXiv preprint arXiv:2509.24384,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.19829","last_updated":"2026-07-22T07:08:59Z","snapshot_observed_at":"2026-08-11T08:08:11.528412Z","submitted_at":"2026-07-22T07:08:59Z","title":"DARWIN: Evolving Jailbreak Adversary and Guardrail for LLM Safety Evaluation and Protection","version":1},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-01T11:40:28.396101Z"},"links":{"citing_paper":"/paper/2607.19829"},"observation_digest":"sha256:a68d55711429e9343070e7132d3eb29bea6b9e93e2ae9951f2c7c1e2bfb11466","observation_id":"f957e25a-8ef6-4671-90fc-f4f47f355516","resolution":{"observed_at":"2026-08-01T11:40:28.396101Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T11:40:28.639197Z","title":"Hotpotqa: A dataset for diverse, explainable multi-hop question answering","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2607.19829","last_updated":"2026-07-22T07:08:59Z","snapshot_observed_at":"2026-08-11T08:08:11.528412Z","submitted_at":"2026-07-22T07:08:59Z","title":"DARWIN: Evolving Jailbreak Adversary and Guardrail for LLM Safety Evaluation and Protection","version":1},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-01T11:40:28.639197Z"},"links":{"citing_paper":"/paper/2607.19829"},"observation_digest":"sha256:a1ed9140abe25e596a08114e59022b8744c62d8567d902d12e8edd6ac58ff8a0","observation_id":"fe54d41a-03dd-41e9-8a8b-b3d9702bcb8e","resolution":{"observed_at":"2026-08-01T11:40:28.639197Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2407.21772","last_updated":"2024-08-04T22:13:39Z","snapshot_observed_at":"2026-08-19T02:59:43.798238Z","submitted_at":"2024-07-31T17:48:14Z","title":"ShieldGemma: Generative AI Content Moderation Based on Gemma","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2407.21772","snapshot_observed_at":"2026-08-01T11:40:28.857968Z","title":"Shieldgemma: Genera- tive ai content moderation based on gemma.arXiv preprint arXiv:2407.21772,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.19829","last_updated":"2026-07-22T07:08:59Z","snapshot_observed_at":"2026-08-11T08:08:11.528412Z","submitted_at":"2026-07-22T07:08:59Z","title":"DARWIN: Evolving Jailbreak Adversary and Guardrail for LLM Safety Evaluation and Protection","version":1},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-01T11:40:28.857968Z"},"links":{"cited_paper":"/paper/2407.21772","citing_paper":"/paper/2607.19829"},"observation_digest":"sha256:c4d7b06b240197cf814aab535e2ee416b6b3e213f0dbd49fbacb85cc83972412","observation_id":"0dbe886c-34d6-43db-a75a-7fa7827063bc","resolution":{"observed_at":"2026-08-01T11:40:28.857968Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2605.29237","last_updated":"2026-08-15T00:47:06Z","snapshot_observed_at":"2026-08-20T14:09:49.235352Z","submitted_at":"2026-05-28T01:53:14Z","title":"Evolving Skill-Structured Attack Memory Enhances LLM Jailbreaking","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2605.29237","snapshot_observed_at":"2026-08-01T11:40:29.039928Z","title":"org/abs/2605.29237","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.19829","last_updated":"2026-07-22T07:08:59Z","snapshot_observed_at":"2026-08-11T08:08:11.528412Z","submitted_at":"2026-07-22T07:08:59Z","title":"DARWIN: Evolving Jailbreak Adversary and Guardrail for LLM Safety Evaluation and Protection","version":1},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-08-01T11:40:29.039928Z"},"links":{"cited_paper":"/paper/2605.29237","citing_paper":"/paper/2607.19829"},"observation_digest":"sha256:11b4a0417c94049b0e2a6b36bb16177d5a841b174cb7f6764b649fab3a7fc60c","observation_id":"d3c2feac-4084-4a7f-9b3a-cb8a85d742be","resolution":{"observed_at":"2026-08-01T11:40:29.039928Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2307.15043","last_updated":"2023-12-20T20:48:57Z","snapshot_observed_at":"2026-08-12T09:06:50.363435Z","submitted_at":"2023-07-27T17:49:12Z","title":"Universal and Transferable Adversarial Attacks on Aligned Language Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2307.15043","snapshot_observed_at":"2026-08-01T11:40:29.288152Z","title":"Universal and transferable adversarial attacks on aligned language models.arXiv preprint arXiv:2307.15043,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.19829","last_updated":"2026-07-22T07:08:59Z","snapshot_observed_at":"2026-08-11T08:08:11.528412Z","submitted_at":"2026-07-22T07:08:59Z","title":"DARWIN: Evolving Jailbreak Adversary and Guardrail for LLM Safety Evaluation and Protection","version":1},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-08-01T11:40:29.288152Z"},"links":{"cited_paper":"/paper/2307.15043","citing_paper":"/paper/2607.19829"},"observation_digest":"sha256:4069f08b4fe807605be4f81f12e62dbbe2dfd20e2a120a80b74625580314201b","observation_id":"15f55aeb-07aa-46dd-8b40-4b1ee674b554","resolution":{"observed_at":"2026-08-01T11:40:29.288152Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2510.14276","last_updated":"2025-10-16T04:00:18Z","snapshot_observed_at":"2026-08-14T07:39:23.817965Z","submitted_at":"2025-10-16T04:00:18Z","title":"Qwen3Guard Technical Report","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2510.14276","snapshot_observed_at":"2026-08-01T11:40:29.208494Z","title":"Qwen3guard technical report.arXiv preprint arXiv:2510.14276,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.19829","last_updated":"2026-07-22T07:08:59Z","snapshot_observed_at":"2026-08-11T08:08:11.528412Z","submitted_at":"2026-07-22T07:08:59Z","title":"DARWIN: Evolving Jailbreak Adversary and Guardrail for LLM Safety Evaluation and Protection","version":1},"reference_index":2015,"source":"pdf_text","source_observed_at":"2026-08-01T11:40:29.208494Z"},"links":{"cited_paper":"/paper/2510.14276","citing_paper":"/paper/2607.19829"},"observation_digest":"sha256:79ded632170d4e98078c85efe149b118db4e27f5b54b75472b8ba8e92721f3b1","observation_id":"6d40fd64-6589-481e-9e53-08b0119ad890","resolution":{"observed_at":"2026-08-01T11:40:29.208494Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2601.15588","last_updated":"2026-07-02T12:42:02Z","snapshot_observed_at":"2026-08-20T01:20:00.990559Z","submitted_at":"2026-01-22T02:23:18Z","title":"YuFeng-XGuard: A Reasoning-Centric, Interpretable, and Flexible Guardrail Model for Large Language Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2601.15588","snapshot_observed_at":"2026-08-01T11:40:26.996387Z","title":"Yufeng-xguard: A reasoning-centric, interpretable, and flexible guardrail model for large language models.arXiv preprint arXiv:2601.15588,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.19829","last_updated":"2026-07-22T07:08:59Z","snapshot_observed_at":"2026-08-11T08:08:11.528412Z","submitted_at":"2026-07-22T07:08:59Z","title":"DARWIN: Evolving Jailbreak Adversary and Guardrail for LLM Safety Evaluation and Protection","version":1},"reference_index":2017,"source":"pdf_text","source_observed_at":"2026-08-01T11:40:26.996387Z"},"links":{"cited_paper":"/paper/2601.15588","citing_paper":"/paper/2607.19829"},"observation_digest":"sha256:967db673f66f152486b22619d3e4a3ac941d3882979de9b63fab3a5cd7665eee","observation_id":"395d7eb0-19b4-49a6-8ddb-268b82d5a129","resolution":{"observed_at":"2026-08-01T11:40:26.996387Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2110.14168","last_updated":"2021-11-18T00:23:45Z","snapshot_observed_at":"2026-08-14T02:43:01.480086Z","submitted_at":"2021-10-27T04:49:45Z","title":"Training Verifiers to Solve Math Word Problems","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2110.14168","snapshot_observed_at":"2026-08-01T11:40:26.463838Z","title":"Training verifiers to solve math word problems.arXiv preprint arXiv:2110.14168,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.19829","last_updated":"2026-07-22T07:08:59Z","snapshot_observed_at":"2026-08-11T08:08:11.528412Z","submitted_at":"2026-07-22T07:08:59Z","title":"DARWIN: Evolving Jailbreak Adversary and Guardrail for LLM Safety Evaluation and Protection","version":1},"reference_index":2018,"source":"pdf_text","source_observed_at":"2026-08-01T11:40:26.463838Z"},"links":{"cited_paper":"/paper/2110.14168","citing_paper":"/paper/2607.19829"},"observation_digest":"sha256:b760e8420f726261f37def156c5774677f14d67efc197e5525c4cece1a35f437","observation_id":"5ba3c237-a16f-4fd8-8a2c-e98f075c15ce","resolution":{"observed_at":"2026-08-01T11:40:26.463838Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1803.05457","last_updated":"2018-03-14T18:04:21Z","snapshot_observed_at":"2026-08-14T19:36:07.505691Z","submitted_at":"2018-03-14T18:04:21Z","title":"Think you have Solved Question Answering? Try ARC, the AI2 Reasoning Challenge","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1803.05457","snapshot_observed_at":"2026-08-01T11:40:26.383606Z","title":"Think you have solved question answering? try arc, the ai2 reasoning challenge","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.19829","last_updated":"2026-07-22T07:08:59Z","snapshot_observed_at":"2026-08-11T08:08:11.528412Z","submitted_at":"2026-07-22T07:08:59Z","title":"DARWIN: Evolving Jailbreak Adversary and Guardrail for LLM Safety Evaluation and Protection","version":1},"reference_index":2019,"source":"pdf_text","source_observed_at":"2026-08-01T11:40:26.383606Z"},"links":{"cited_paper":"/paper/1803.05457","citing_paper":"/paper/2607.19829"},"observation_digest":"sha256:fca04e42b33866a9d8f743eb6bb7c414b1ea2d7c1cf8690844a4644bdc6c8797","observation_id":"1f6a45b4-2ba2-4116-afa2-68f9d5e552bf","resolution":{"observed_at":"2026-08-01T11:40:26.383606Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T11:40:26.932655Z","title":"Race: Large-scale reading comprehension dataset from examinations","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2607.19829","last_updated":"2026-07-22T07:08:59Z","snapshot_observed_at":"2026-08-11T08:08:11.528412Z","submitted_at":"2026-07-22T07:08:59Z","title":"DARWIN: Evolving Jailbreak Adversary and Guardrail for LLM Safety Evaluation and Protection","version":1},"reference_index":2020,"source":"pdf_text","source_observed_at":"2026-08-01T11:40:26.932655Z"},"links":{"citing_paper":"/paper/2607.19829"},"observation_digest":"sha256:d1c6f36e5bd432416606df0020cb64242aa3fddfd9fe9d15150b9038a5bb8377","observation_id":"13b206d3-c391-4ac3-ba2d-c0fd199f33f4","resolution":{"observed_at":"2026-08-01T11:40:26.932655Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T11:40:26.561319Z","title":"A wolf in sheep’s clothing: Generalized nested jailbreak prompts can fool large language models easily","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.19829","last_updated":"2026-07-22T07:08:59Z","snapshot_observed_at":"2026-08-11T08:08:11.528412Z","submitted_at":"2026-07-22T07:08:59Z","title":"DARWIN: Evolving Jailbreak Adversary and Guardrail for LLM Safety Evaluation and Protection","version":1},"reference_index":2021,"source":"pdf_text","source_observed_at":"2026-08-01T11:40:26.561319Z"},"links":{"citing_paper":"/paper/2607.19829"},"observation_digest":"sha256:d4f3946ea4cc6e3ae84313cfbb159f37a490842d6f4fd82fcc2c9fb436dc173b","observation_id":"e6f17d31-b5a2-4056-926d-74a0b212b90c","resolution":{"observed_at":"2026-08-01T11:40:26.561319Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T11:40:27.181672Z","title":"Autodan: Generating stealthy jailbreak prompts on aligned large language models","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.19829","last_updated":"2026-07-22T07:08:59Z","snapshot_observed_at":"2026-08-11T08:08:11.528412Z","submitted_at":"2026-07-22T07:08:59Z","title":"DARWIN: Evolving Jailbreak Adversary and Guardrail for LLM Safety Evaluation and Protection","version":1},"reference_index":2023,"source":"pdf_text","source_observed_at":"2026-08-01T11:40:27.181672Z"},"links":{"citing_paper":"/paper/2607.19829"},"observation_digest":"sha256:526ea0e79a4d0336f83920722f24a06e0442fb4e6f998284dd6f906f81ba3f52","observation_id":"c8def011-a8e3-4757-8c17-ccc5f25fcd72","resolution":{"observed_at":"2026-08-01T11:40:27.181672Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T11:40:26.624887Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.19829","last_updated":"2026-07-22T07:08:59Z","snapshot_observed_at":"2026-08-11T08:08:11.528412Z","submitted_at":"2026-07-22T07:08:59Z","title":"DARWIN: Evolving Jailbreak Adversary and Guardrail for LLM Safety Evaluation and Protection","version":1},"reference_index":2024,"source":"pdf_text","source_observed_at":"2026-08-01T11:40:26.624887Z"},"links":{"citing_paper":"/paper/2607.19829"},"observation_digest":"sha256:f9f1739df7f6894b672bc0bc3e3232b260695cd6118efc269965a46f5c30a27d","observation_id":"a3fe96a3-5ae9-4aa7-a047-2c6670dbf6b5","resolution":{"observed_at":"2026-08-01T11:40:26.624887Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T11:40:26.781514Z","title":"Dualbreach: Efficient dual-jailbreaking via target-driven initialization and multi- target optimization.arXiv preprint arXiv:2504.18564,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.19829","last_updated":"2026-07-22T07:08:59Z","snapshot_observed_at":"2026-08-11T08:08:11.528412Z","submitted_at":"2026-07-22T07:08:59Z","title":"DARWIN: Evolving Jailbreak Adversary and Guardrail for LLM Safety Evaluation and Protection","version":1},"reference_index":2025,"source":"pdf_text","source_observed_at":"2026-08-01T11:40:26.781514Z"},"links":{"citing_paper":"/paper/2607.19829"},"observation_digest":"sha256:2a16cb136f64240bc595d1ae5ce267b4628038145fd535fd45f571b61d7d4744","observation_id":"70930a7a-5005-46e0-ae70-a2fe46ce03fa","resolution":{"observed_at":"2026-08-01T11:40:26.781514Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2510.02999","last_updated":"2026-07-08T01:24:56Z","snapshot_observed_at":"2026-08-15T19:01:43.160819Z","submitted_at":"2025-10-03T13:38:56Z","title":"NonTextual Target Attack","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2510.02999","snapshot_observed_at":"2026-08-01T11:40:26.849024Z","title":"Hakan Inan, Kartikeya Upasani, Jianfeng Chi, Rashi Rungta, Krithika Iyer, Yuning Mao, Michael Tontchev, Qing Hu, Brian Fuller, Davide Testuggine, et al","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.19829","last_updated":"2026-07-22T07:08:59Z","snapshot_observed_at":"2026-08-11T08:08:11.528412Z","submitted_at":"2026-07-22T07:08:59Z","title":"DARWIN: Evolving Jailbreak Adversary and Guardrail for LLM Safety Evaluation and Protection","version":1},"reference_index":2026,"source":"pdf_text","source_observed_at":"2026-08-01T11:40:26.849024Z"},"links":{"cited_paper":"/paper/2510.02999","citing_paper":"/paper/2607.19829"},"observation_digest":"sha256:4ed5c6ff5f2ae9a7f7ff3584a6d63672b6e8a85e5f51da3f9cbfa4058d26bd2d","observation_id":"e8aaf750-6a18-4fec-9160-935d9589216e","resolution":{"observed_at":"2026-08-01T11:40:26.849024Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"paper":{"arxiv_id":"2607.19829","last_updated":"2026-07-22T07:08:59Z","latest_version":1,"primary_category":"cs.CR","snapshot_observed_at":"2026-08-11T08:08:11.528412Z","submitted_at":"2026-07-22T07:08:59Z","title":"DARWIN: Evolving Jailbreak Adversary and Guardrail for LLM Safety Evaluation and Protection"},"reference_resolution":{"displayed":27,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":27,"verified_exact":0,"verified_fuzzy":0},"total_outbound_references":27},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"thesis":"As of 20 August 2026, this Paper Citation Record lists 27 of 27 outbound references and 2 inbound Pith citation observations for arXiv:2607.19829."}