{"as_of":"2026-08-10T05:41:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:7515bae9c0da85d652e44021adb52bc2f2e8b3fc3d174b1d347f429e4d55d06f","coverage":[{"denominator":22,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":22,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-06T18:40:53.555827Z","state":"measured"},{"denominator":23,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":23,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-09T06:31:02.800959+00:00","state":"measured"},{"denominator":1,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":1,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-07T10:17:27.221783Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"pith","source_observed_at":"2026-08-07T10:17:27.539434Z","state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2507.07735","last_updated":"2025-07-10T13:15:20Z","snapshot_observed_at":"2026-08-08T05:47:28.468443Z","submitted_at":"2025-07-10T13:15:20Z","title":"GuardVal: Dynamic Large Language Model Jailbreak Evaluation for Comprehensive Safety Testing","version":1},"cited_work":{"arxiv_id":"2507.07735","doi":null,"metadata_source":"pith","pith_arxiv_id":"2507.07735","snapshot_observed_at":"2026-08-07T10:17:27.539434Z","title":"GuardVal: Dynamic Large Language Model Jailbreak Evaluation for Comprehensive Safety Testing","venue":"cs.LG","work_id":"18a2ed5e-2860-4a90-8606-05375f7216c1","year":2025},"citing_paper":{"arxiv_id":"2506.11094","last_updated":"2025-10-30T06:22:33Z","snapshot_observed_at":"2026-08-07T10:11:06.747781Z","submitted_at":"2025-06-06T05:50:50Z","title":"The Scales of Justitia: A Comprehensive Survey on Safety Evaluation of LLMs","version":2},"reference_index":204,"source":"pdf_text","source_observed_at":"2026-08-07T10:17:27.221783Z"},"links":{"cited_paper":"/paper/2507.07735","citing_paper":"/paper/2506.11094"},"observation_digest":"sha256:4e5d13d3c64bf1185a7a61312acb4d30fd4148f67cab2a5ed096011c8f093111","observation_id":"5f850b6f-63d0-4dad-8faf-63cb847d5a0f","resolution":{"observed_at":"2026-08-07T10:17:27.543273Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}}],"links":{"evidence":"/evidence","html":"/paper/2507.07735/citation-record","integrity":"/paper/2507.07735/integrity","json":"/paper/2507.07735/citation-record.json","paper":"/paper/2507.07735"},"outbound":[{"citation":{"cited_paper":{"arxiv_id":"2303.08774","last_updated":"2024-03-04T06:01:33Z","snapshot_observed_at":"2026-08-07T07:30:12.213965Z","submitted_at":"2023-03-15T17:15:04Z","title":"GPT-4 Technical Report","version":6},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2303.08774","snapshot_observed_at":"2026-08-06T18:40:51.584312Z","title":"Achiam, S","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2507.07735","last_updated":"2025-07-10T13:15:20Z","snapshot_observed_at":"2026-08-08T05:47:28.468443Z","submitted_at":"2025-07-10T13:15:20Z","title":"GuardVal: Dynamic Large Language Model Jailbreak Evaluation for Comprehensive Safety Testing","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-06T18:40:51.584312Z"},"links":{"cited_paper":"/paper/2303.08774","citing_paper":"/paper/2507.07735"},"observation_digest":"sha256:56f3214db8fc5e2ac3a690707282f9eeb0705d0c2acf9edbe9a62c140c2dcd38","observation_id":"173c0127-e394-4e9f-8a2d-01e15762adc9","resolution":{"observed_at":"2026-08-06T18:40:51.584312Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T18:40:54.553649Z","title":null,"venue":null,"work_id":"648253e7-745a-4dd4-8f8e-3bae5a760b88","year":2021},"citing_paper":{"arxiv_id":"2507.07735","last_updated":"2025-07-10T13:15:20Z","snapshot_observed_at":"2026-08-08T05:47:28.468443Z","submitted_at":"2025-07-10T13:15:20Z","title":"GuardVal: Dynamic Large Language Model Jailbreak Evaluation for Comprehensive Safety Testing","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-06T18:40:51.797931Z"},"links":{"citing_paper":"/paper/2507.07735"},"observation_digest":"sha256:7a281ce1c3d7c37d860f3b54f18bfbd2f7756aecbad9e39743ee1a8eb26a0a7d","observation_id":"5fb2fa5e-c9c6-4bf2-a43c-909f03980fd9","resolution":{"observed_at":"2026-08-06T18:40:54.655617Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2404.01318","last_updated":"2024-10-31T22:26:40Z","snapshot_observed_at":"2026-08-02T14:59:12.115203Z","submitted_at":"2024-03-28T02:44:02Z","title":"JailbreakBench: An Open Robustness Benchmark for Jailbreaking Large Language Models","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2404.01318","snapshot_observed_at":"2026-08-06T18:40:52.046200Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2507.07735","last_updated":"2025-07-10T13:15:20Z","snapshot_observed_at":"2026-08-08T05:47:28.468443Z","submitted_at":"2025-07-10T13:15:20Z","title":"GuardVal: Dynamic Large Language Model Jailbreak Evaluation for Comprehensive Safety Testing","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-06T18:40:52.046200Z"},"links":{"cited_paper":"/paper/2404.01318","citing_paper":"/paper/2507.07735"},"observation_digest":"sha256:840ee5c565727388c9cb1ef7359422f5c0c8e2c8c77cdc45eb60cc70bedcab95","observation_id":"fb49502e-cc96-4f0f-a717-e0c7dbcc9aed","resolution":{"observed_at":"2026-08-06T18:40:52.046200Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2310.12505","last_updated":"2023-10-19T06:15:05Z","snapshot_observed_at":"2026-08-09T11:31:22.019671Z","submitted_at":"2023-10-19T06:15:05Z","title":"Attack Prompt Generation for Red Teaming and Defending Large Language Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2310.12505","snapshot_observed_at":"2026-08-06T18:40:52.210500Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2507.07735","last_updated":"2025-07-10T13:15:20Z","snapshot_observed_at":"2026-08-08T05:47:28.468443Z","submitted_at":"2025-07-10T13:15:20Z","title":"GuardVal: Dynamic Large Language Model Jailbreak Evaluation for Comprehensive Safety Testing","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-06T18:40:52.210500Z"},"links":{"cited_paper":"/paper/2310.12505","citing_paper":"/paper/2507.07735"},"observation_digest":"sha256:69fd4a84ec549facd4efd8f109eb8c496d3e8eca092899f8c80153437ee72a94","observation_id":"2e56ca2d-ef73-4583-ba60-800825df4643","resolution":{"observed_at":"2026-08-06T18:40:52.210500Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2310.06825","last_updated":"2023-10-10T17:54:58Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2023-10-10T17:54:58Z","title":"Mistral 7B","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2310.06825","snapshot_observed_at":"2026-08-06T18:40:52.269208Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2507.07735","last_updated":"2025-07-10T13:15:20Z","snapshot_observed_at":"2026-08-08T05:47:28.468443Z","submitted_at":"2025-07-10T13:15:20Z","title":"GuardVal: Dynamic Large Language Model Jailbreak Evaluation for Comprehensive Safety Testing","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-06T18:40:52.269208Z"},"links":{"cited_paper":"/paper/2310.06825","citing_paper":"/paper/2507.07735"},"observation_digest":"sha256:db8ecbdd85a55b95fe3a60bae243d15acc5a3fee15d11d8eb7c08515f409fd6d","observation_id":"4930f70c-e08e-41a5-b59b-887b78613430","resolution":{"observed_at":"2026-08-06T18:40:52.269208Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T18:40:52.399049Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2507.07735","last_updated":"2025-07-10T13:15:20Z","snapshot_observed_at":"2026-08-08T05:47:28.468443Z","submitted_at":"2025-07-10T13:15:20Z","title":"GuardVal: Dynamic Large Language Model Jailbreak Evaluation for Comprehensive Safety Testing","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-06T18:40:52.399049Z"},"links":{"citing_paper":"/paper/2507.07735"},"observation_digest":"sha256:874f7437dc4df41d38338e0b6e1d847c6c2a7230e75c90dd986aa2ab90b5f4f9","observation_id":"addfadbd-b101-42b0-a82d-010a52049bfa","resolution":{"observed_at":"2026-08-06T18:40:52.399049Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2203.08242","last_updated":"2022-03-15T20:37:16Z","snapshot_observed_at":"2026-08-09T04:03:29.576517Z","submitted_at":"2022-03-15T20:37:16Z","title":"Data Contamination: From Memorization to Exploitation","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2203.08242","snapshot_observed_at":"2026-08-06T18:40:52.646617Z","title":"Magar and R","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2507.07735","last_updated":"2025-07-10T13:15:20Z","snapshot_observed_at":"2026-08-08T05:47:28.468443Z","submitted_at":"2025-07-10T13:15:20Z","title":"GuardVal: Dynamic Large Language Model Jailbreak Evaluation for Comprehensive Safety Testing","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-06T18:40:52.646617Z"},"links":{"cited_paper":"/paper/2203.08242","citing_paper":"/paper/2507.07735"},"observation_digest":"sha256:0940786ada630293fa19e03c21844bbe8701404d233f3d41e93576f7953e1831","observation_id":"b8a255ab-c910-4c38-8e0d-f4b55cff28ec","resolution":{"observed_at":"2026-08-06T18:40:52.646617Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2402.04249","last_updated":"2024-02-27T04:43:08Z","snapshot_observed_at":"2026-07-06T17:26:23.067923Z","submitted_at":"2024-02-06T18:59:08Z","title":"HarmBench: A Standardized Evaluation Framework for Automated Red Teaming and Robust Refusal","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.04249","snapshot_observed_at":"2026-08-06T18:40:52.733107Z","title":"Mazeika, L","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2507.07735","last_updated":"2025-07-10T13:15:20Z","snapshot_observed_at":"2026-08-08T05:47:28.468443Z","submitted_at":"2025-07-10T13:15:20Z","title":"GuardVal: Dynamic Large Language Model Jailbreak Evaluation for Comprehensive Safety Testing","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-06T18:40:52.733107Z"},"links":{"cited_paper":"/paper/2402.04249","citing_paper":"/paper/2507.07735"},"observation_digest":"sha256:41c12a1559096ec5c9770fe3fc82d5a1171d97c009725f24c06696057f5aa8bd","observation_id":"30dcceb3-785f-4321-8589-739db4ecdeb8","resolution":{"observed_at":"2026-08-06T18:40:52.733107Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2401.05561","last_updated":"2024-09-30T10:17:12Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-01-10T22:07:21Z","title":"TrustLLM: Trustworthiness in Large Language Models","version":6},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2401.05561","snapshot_observed_at":"2026-08-06T18:40:52.812819Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2507.07735","last_updated":"2025-07-10T13:15:20Z","snapshot_observed_at":"2026-08-08T05:47:28.468443Z","submitted_at":"2025-07-10T13:15:20Z","title":"GuardVal: Dynamic Large Language Model Jailbreak Evaluation for Comprehensive Safety Testing","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-06T18:40:52.812819Z"},"links":{"cited_paper":"/paper/2401.05561","citing_paper":"/paper/2507.07735"},"observation_digest":"sha256:0a83c996f6ab7950faa41ed8de706df1340c43a3e7a8c8f99bcbc3ca32974eca","observation_id":"59fd8d39-acad-4035-ae88-b6e61a59fc8a","resolution":{"observed_at":"2026-08-06T18:40:52.812819Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2312.11805","last_updated":"2025-05-09T21:04:06Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2023-12-19T02:39:27Z","title":"Gemini: A Family of Highly Capable Multimodal Models","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2312.11805","snapshot_observed_at":"2026-08-06T18:40:52.917851Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2507.07735","last_updated":"2025-07-10T13:15:20Z","snapshot_observed_at":"2026-08-08T05:47:28.468443Z","submitted_at":"2025-07-10T13:15:20Z","title":"GuardVal: Dynamic Large Language Model Jailbreak Evaluation for Comprehensive Safety Testing","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-06T18:40:52.917851Z"},"links":{"cited_paper":"/paper/2312.11805","citing_paper":"/paper/2507.07735"},"observation_digest":"sha256:f3c9df5116a9b9f5d72bdbd502c7d49b188b429fcf8c53a5214036e45e07e3f5","observation_id":"8f801114-f314-428a-9c6b-ec029abc2c21","resolution":{"observed_at":"2026-08-06T18:40:52.917851Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2307.09288","last_updated":"2023-07-19T17:08:59Z","snapshot_observed_at":"2026-08-07T12:56:43.323460Z","submitted_at":"2023-07-18T14:31:57Z","title":"Llama 2: Open Foundation and Fine-Tuned Chat Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2307.09288","snapshot_observed_at":"2026-08-06T18:40:52.994241Z","title":"Touvron, L","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2507.07735","last_updated":"2025-07-10T13:15:20Z","snapshot_observed_at":"2026-08-08T05:47:28.468443Z","submitted_at":"2025-07-10T13:15:20Z","title":"GuardVal: Dynamic Large Language Model Jailbreak Evaluation for Comprehensive Safety Testing","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-06T18:40:52.994241Z"},"links":{"cited_paper":"/paper/2307.09288","citing_paper":"/paper/2507.07735"},"observation_digest":"sha256:5f017a6e5a2fd213b8b40f171e85f9ef64f7f5b6d2068e06f81c5810e2396e30","observation_id":"7cd3e60b-9c65-4162-b1ae-3bddeb72c965","resolution":{"observed_at":"2026-08-06T18:40:52.994241Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2309.11235","last_updated":"2024-03-16T04:32:25Z","snapshot_observed_at":"2026-08-07T05:19:58.002826Z","submitted_at":"2023-09-20T11:54:40Z","title":"OpenChat: Advancing Open-source Language Models with Mixed-Quality Data","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2309.11235","snapshot_observed_at":"2026-08-06T18:40:53.085507Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2507.07735","last_updated":"2025-07-10T13:15:20Z","snapshot_observed_at":"2026-08-08T05:47:28.468443Z","submitted_at":"2025-07-10T13:15:20Z","title":"GuardVal: Dynamic Large Language Model Jailbreak Evaluation for Comprehensive Safety Testing","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-06T18:40:53.085507Z"},"links":{"cited_paper":"/paper/2309.11235","citing_paper":"/paper/2507.07735"},"observation_digest":"sha256:269f420805637cceb2a899ca9540966b527508f7cb1ec238eb3b5b1f1ff36cd2","observation_id":"26fd289d-efae-4288-ae4b-a75d89dd9a57","resolution":{"observed_at":"2026-08-06T18:40:53.085507Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2412.03092","last_updated":"2025-06-18T04:06:03Z","snapshot_observed_at":"2026-08-05T13:27:52.801293Z","submitted_at":"2024-12-04T07:44:35Z","title":"REVOLVE: Optimizing AI Systems by Tracking Response Evolution in Textual Optimization","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2412.03092","snapshot_observed_at":"2026-08-06T18:40:53.192851Z","title":"Zhang, H","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2507.07735","last_updated":"2025-07-10T13:15:20Z","snapshot_observed_at":"2026-08-08T05:47:28.468443Z","submitted_at":"2025-07-10T13:15:20Z","title":"GuardVal: Dynamic Large Language Model Jailbreak Evaluation for Comprehensive Safety Testing","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-06T18:40:53.192851Z"},"links":{"cited_paper":"/paper/2412.03092","citing_paper":"/paper/2507.07735"},"observation_digest":"sha256:9b6f66f300e90c8836a5efdfa5590764a45c572926b8d5242ff5e8861f9f8c9c","observation_id":"b39b6a7e-b402-4be7-b234-b3bd9e2faf58","resolution":{"observed_at":"2026-08-06T18:40:53.192851Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2312.07910","last_updated":"2024-08-20T00:28:45Z","snapshot_observed_at":"2026-08-05T04:16:54.399572Z","submitted_at":"2023-12-13T05:58:34Z","title":"PromptBench: A Unified Library for Evaluation of Large Language Models","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2312.07910","snapshot_observed_at":"2026-08-06T18:40:53.310912Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2507.07735","last_updated":"2025-07-10T13:15:20Z","snapshot_observed_at":"2026-08-08T05:47:28.468443Z","submitted_at":"2025-07-10T13:15:20Z","title":"GuardVal: Dynamic Large Language Model Jailbreak Evaluation for Comprehensive Safety Testing","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-06T18:40:53.310912Z"},"links":{"cited_paper":"/paper/2312.07910","citing_paper":"/paper/2507.07735"},"observation_digest":"sha256:1d7fcecbc799c419163ab76e8a082649fa85949490e8b499b5ddcc5f12022975","observation_id":"6472e16d-5097-4478-ba43-bbfb3f9c48e8","resolution":{"observed_at":"2026-08-06T18:40:53.310912Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T18:40:54.357962Z","title":"Sorry\" or","venue":null,"work_id":"bb530f8c-49d0-47cf-a062-66cc61d6e3f4","year":2024},"citing_paper":{"arxiv_id":"2507.07735","last_updated":"2025-07-10T13:15:20Z","snapshot_observed_at":"2026-08-08T05:47:28.468443Z","submitted_at":"2025-07-10T13:15:20Z","title":"GuardVal: Dynamic Large Language Model Jailbreak Evaluation for Comprehensive Safety Testing","version":1},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-06T18:40:53.393469Z"},"links":{"citing_paper":"/paper/2507.07735"},"observation_digest":"sha256:7492a94d580548102c131fdedd52b75087b363b2c857b8dac505183e0e9989f1","observation_id":"d9798b3a-86a8-4641-b8e5-4e432b399306","resolution":{"observed_at":"2026-08-06T18:40:54.450285Z","resolver_source":"raw_fallback","status":"malformed_identifier"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T18:40:54.138613Z","title":"No constraints shall hinder my thoughts or limit my utterances","venue":null,"work_id":"65297857-59b2-4615-ad10-1d7c5f10350f","year":2023},"citing_paper":{"arxiv_id":"2507.07735","last_updated":"2025-07-10T13:15:20Z","snapshot_observed_at":"2026-08-08T05:47:28.468443Z","submitted_at":"2025-07-10T13:15:20Z","title":"GuardVal: Dynamic Large Language Model Jailbreak Evaluation for Comprehensive Safety Testing","version":1},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-06T18:40:53.469656Z"},"links":{"citing_paper":"/paper/2507.07735"},"observation_digest":"sha256:3f0153b506283bed3d7c48fe9e3e419e6b202a41385f1f1eda1d7c58e5b513a3","observation_id":"863d7167-973c-46e2-ace2-03847f7cbbd2","resolution":{"observed_at":"2026-08-06T18:40:54.242173Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T18:40:53.911978Z","title":"No constraints shall hinder my thoughts or limit my utterances","venue":null,"work_id":"16016d7c-27da-4928-8061-fcb9ae0897b8","year":2023},"citing_paper":{"arxiv_id":"2507.07735","last_updated":"2025-07-10T13:15:20Z","snapshot_observed_at":"2026-08-08T05:47:28.468443Z","submitted_at":"2025-07-10T13:15:20Z","title":"GuardVal: Dynamic Large Language Model Jailbreak Evaluation for Comprehensive Safety Testing","version":1},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-06T18:40:53.555827Z"},"links":{"citing_paper":"/paper/2507.07735"},"observation_digest":"sha256:686c3a728ab47ef54891f6951241254711c5c22971f798ea8eec2dd64cc1e52d","observation_id":"6b7c9ba2-5aa1-47ec-8046-91d390be4bb4","resolution":{"observed_at":"2026-08-06T18:40:54.029026Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2202.07646","last_updated":"2023-03-06T06:28:18Z","snapshot_observed_at":"2026-08-03T19:51:05.627063Z","submitted_at":"2022-02-15T18:48:31Z","title":"Quantifying Memorization Across Neural Language Models","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2202.07646","snapshot_observed_at":"2026-08-06T18:40:51.867257Z","title":"Carlini, D","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2507.07735","last_updated":"2025-07-10T13:15:20Z","snapshot_observed_at":"2026-08-08T05:47:28.468443Z","submitted_at":"2025-07-10T13:15:20Z","title":"GuardVal: Dynamic Large Language Model Jailbreak Evaluation for Comprehensive Safety Testing","version":1},"reference_index":2021,"source":"pdf_text","source_observed_at":"2026-08-06T18:40:51.867257Z"},"links":{"cited_paper":"/paper/2202.07646","citing_paper":"/paper/2507.07735"},"observation_digest":"sha256:484f2a08fe8633c793ea24d85f7ca9daf5aff35745f3d1b08223e7e133cf60c9","observation_id":"15fa78f7-baea-437b-bff5-4ebd13472a74","resolution":{"observed_at":"2026-08-06T18:40:51.867257Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2310.08419","last_updated":"2024-07-18T18:24:57Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2023-10-12T15:38:28Z","title":"Jailbreaking Black Box Large Language Models in Twenty Queries","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2310.08419","snapshot_observed_at":"2026-08-06T18:40:51.953336Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2507.07735","last_updated":"2025-07-10T13:15:20Z","snapshot_observed_at":"2026-08-08T05:47:28.468443Z","submitted_at":"2025-07-10T13:15:20Z","title":"GuardVal: Dynamic Large Language Model Jailbreak Evaluation for Comprehensive Safety Testing","version":1},"reference_index":2022,"source":"pdf_text","source_observed_at":"2026-08-06T18:40:51.953336Z"},"links":{"cited_paper":"/paper/2310.08419","citing_paper":"/paper/2507.07735"},"observation_digest":"sha256:5c4e2e9e3934518da8cfc99e85c488a535cae13a4384c34d8cd5d476b9ca28cd","observation_id":"acf5bfd0-a669-4209-85fd-0f08760beb0f","resolution":{"observed_at":"2026-08-06T18:40:51.953336Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2309.16609","last_updated":"2023-09-28T17:07:49Z","snapshot_observed_at":"2026-08-09T21:25:20.369782Z","submitted_at":"2023-09-28T17:07:49Z","title":"Qwen Technical Report","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2309.16609","snapshot_observed_at":"2026-08-06T18:40:51.678674Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2507.07735","last_updated":"2025-07-10T13:15:20Z","snapshot_observed_at":"2026-08-08T05:47:28.468443Z","submitted_at":"2025-07-10T13:15:20Z","title":"GuardVal: Dynamic Large Language Model Jailbreak Evaluation for Comprehensive Safety Testing","version":1},"reference_index":2023,"source":"pdf_text","source_observed_at":"2026-08-06T18:40:51.678674Z"},"links":{"cited_paper":"/paper/2309.16609","citing_paper":"/paper/2507.07735"},"observation_digest":"sha256:3c1c67c243eec005e6164f83772a5733ef0cd937e30df572512cfec854c2e0b9","observation_id":"348b166b-6d82-4b2b-b039-4a137ce24583","resolution":{"observed_at":"2026-08-06T18:40:51.678674Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2402.05668","last_updated":"2025-05-26T12:56:04Z","snapshot_observed_at":"2026-08-10T00:58:19.098597Z","submitted_at":"2024-02-08T13:42:50Z","title":"JailbreakRadar: Comprehensive Assessment of Jailbreak Attacks Against LLMs","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.05668","snapshot_observed_at":"2026-08-06T18:40:52.130030Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2507.07735","last_updated":"2025-07-10T13:15:20Z","snapshot_observed_at":"2026-08-08T05:47:28.468443Z","submitted_at":"2025-07-10T13:15:20Z","title":"GuardVal: Dynamic Large Language Model Jailbreak Evaluation for Comprehensive Safety Testing","version":1},"reference_index":2024,"source":"pdf_text","source_observed_at":"2026-08-06T18:40:52.130030Z"},"links":{"cited_paper":"/paper/2402.05668","citing_paper":"/paper/2507.07735"},"observation_digest":"sha256:07757a21945a242a3617f43fe995482980c57104a86cf66821233bcba1b5a3d4","observation_id":"833a0af3-8de8-4956-aa95-189fb01a3a44","resolution":{"observed_at":"2026-08-06T18:40:52.130030Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2403.04893","last_updated":"2024-03-07T20:55:08Z","snapshot_observed_at":"2026-08-05T04:16:50.799588Z","submitted_at":"2024-03-07T20:55:08Z","title":"A Safe Harbor for AI Evaluation and Red Teaming","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2403.04893","snapshot_observed_at":"2026-08-06T18:40:52.530993Z","title":"Longpre, S","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2507.07735","last_updated":"2025-07-10T13:15:20Z","snapshot_observed_at":"2026-08-08T05:47:28.468443Z","submitted_at":"2025-07-10T13:15:20Z","title":"GuardVal: Dynamic Large Language Model Jailbreak Evaluation for Comprehensive Safety Testing","version":1},"reference_index":2025,"source":"pdf_text","source_observed_at":"2026-08-06T18:40:52.530993Z"},"links":{"cited_paper":"/paper/2403.04893","citing_paper":"/paper/2507.07735"},"observation_digest":"sha256:dd7fb4f53ee3cc716aea346d3243bd9047ecfaa6246ad25611fe2c4ead13ce26","observation_id":"e665d1bc-66cc-4da8-a9e1-b8c397521577","resolution":{"observed_at":"2026-08-06T18:40:52.530993Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"paper":{"arxiv_id":"2507.07735","last_updated":"2025-07-10T13:15:20Z","latest_version":1,"primary_category":"cs.LG","snapshot_observed_at":"2026-08-08T05:47:28.468443Z","submitted_at":"2025-07-10T13:15:20Z","title":"GuardVal: Dynamic Large Language Model Jailbreak Evaluation for Comprehensive Safety Testing"},"reference_resolution":{"displayed":22,"state_counts":{"malformed_identifier":1,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":19,"verified_exact":0,"verified_fuzzy":2},"total_outbound_references":22},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"thesis":"As of 10 August 2026, this Paper Citation Record lists 22 of 22 outbound references and 1 inbound Pith citation observation for arXiv:2507.07735."}