{"as_of":"2026-08-14T15:11:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:6a00e7223533cd0ffa7954bb0ee63b6f6251ac74c3624c04c26356530d2f775b","coverage":[{"denominator":21,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":21,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-05T00:48:49.845907Z","state":"measured"},{"denominator":21,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":21,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-14T06:32:32.682623+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2608.02665/citation-record","integrity":"/paper/2608.02665/integrity","json":"/paper/2608.02665/citation-record.json","paper":"/paper/2608.02665"},"outbound":[{"citation":{"cited_paper":{"arxiv_id":"2409.00598","last_updated":"2025-06-11T03:14:28Z","snapshot_observed_at":"2026-08-12T22:53:45.994099Z","submitted_at":"2024-09-01T03:25:59Z","title":"Automatic Pseudo-Harmful Prompt Generation for Evaluating False Refusals in Large Language Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2409.00598","snapshot_observed_at":"2026-08-05T00:48:47.691899Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2608.02665","last_updated":"2026-08-01T22:28:31Z","snapshot_observed_at":"2026-08-14T14:09:23.946946Z","submitted_at":"2026-08-01T22:28:31Z","title":"Single Canonical Prompts Underestimate LLM Safety's Surface-Form Sensitivity","version":1},"reference_index":1,"source":"arxiv_source","source_observed_at":"2026-08-05T00:48:47.691899Z"},"links":{"cited_paper":"/paper/2409.00598","citing_paper":"/paper/2608.02665"},"observation_digest":"sha256:4ab09c7f3d4006699d3b328e7542368a5452c328e8ee14e928a0999f0aedbc45","observation_id":"73d5e304-eaf1-4e55-adbf-64fc2f51e490","resolution":{"observed_at":"2026-08-05T00:48:47.691899Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T00:48:53.011749Z","title":"Pappas, Florian Tramer, Hamed Hassani, and Eric Wong","venue":null,"work_id":"c98a2d3b-ea74-419b-baa9-e7c5beeb6df1","year":2024},"citing_paper":{"arxiv_id":"2608.02665","last_updated":"2026-08-01T22:28:31Z","snapshot_observed_at":"2026-08-14T14:09:23.946946Z","submitted_at":"2026-08-01T22:28:31Z","title":"Single Canonical Prompts Underestimate LLM Safety's Surface-Form Sensitivity","version":1},"reference_index":2,"source":"arxiv_source","source_observed_at":"2026-08-05T00:48:47.816131Z"},"links":{"citing_paper":"/paper/2608.02665"},"observation_digest":"sha256:cfb115f27169d255a60276b125288d4ec31550778849d0f106019c60f35aabbf","observation_id":"60ade032-b860-4a8c-bffc-634a86ebd9d8","resolution":{"observed_at":"2026-08-05T00:48:53.100173Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2405.20947","last_updated":"2025-06-15T21:44:25Z","snapshot_observed_at":"2026-08-12T23:53:16.785416Z","submitted_at":"2024-05-31T15:44:33Z","title":"OR-Bench: An Over-Refusal Benchmark for Large Language Models","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2405.20947","snapshot_observed_at":"2026-08-05T00:48:47.873645Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2608.02665","last_updated":"2026-08-01T22:28:31Z","snapshot_observed_at":"2026-08-14T14:09:23.946946Z","submitted_at":"2026-08-01T22:28:31Z","title":"Single Canonical Prompts Underestimate LLM Safety's Surface-Form Sensitivity","version":1},"reference_index":3,"source":"arxiv_source","source_observed_at":"2026-08-05T00:48:47.873645Z"},"links":{"cited_paper":"/paper/2405.20947","citing_paper":"/paper/2608.02665"},"observation_digest":"sha256:25563a00bf54f1f0e26b384978c7a75110e480806fb5e23611d1233267e327df","observation_id":"58f0fcc2-0fb7-4eac-9743-37fcf82efc48","resolution":{"observed_at":"2026-08-05T00:48:47.873645Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T00:48:52.796012Z","title":null,"venue":null,"work_id":"19e18cae-efe4-4346-8003-3c81d3a44951","year":2024},"citing_paper":{"arxiv_id":"2608.02665","last_updated":"2026-08-01T22:28:31Z","snapshot_observed_at":"2026-08-14T14:09:23.946946Z","submitted_at":"2026-08-01T22:28:31Z","title":"Single Canonical Prompts Underestimate LLM Safety's Surface-Form Sensitivity","version":1},"reference_index":4,"source":"arxiv_source","source_observed_at":"2026-08-05T00:48:47.964952Z"},"links":{"citing_paper":"/paper/2608.02665"},"observation_digest":"sha256:4b41d9aff3ff3be468d40885d278cb8a839f9ddff844ff8bdb6a96557b4ba1dd","observation_id":"5dc7053d-6fff-4f28-a9c3-00cb61985a9a","resolution":{"observed_at":"2026-08-05T00:48:52.868473Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2412.03556","last_updated":"2024-12-19T22:37:45Z","snapshot_observed_at":"2026-08-13T20:19:28.959688Z","submitted_at":"2024-12-04T18:51:32Z","title":"Best-of-N Jailbreaking","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2412.03556","snapshot_observed_at":"2026-08-05T00:48:48.102460Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2608.02665","last_updated":"2026-08-01T22:28:31Z","snapshot_observed_at":"2026-08-14T14:09:23.946946Z","submitted_at":"2026-08-01T22:28:31Z","title":"Single Canonical Prompts Underestimate LLM Safety's Surface-Form Sensitivity","version":1},"reference_index":5,"source":"arxiv_source","source_observed_at":"2026-08-05T00:48:48.102460Z"},"links":{"cited_paper":"/paper/2412.03556","citing_paper":"/paper/2608.02665"},"observation_digest":"sha256:86fbed1693c27284550495b575e6220cbab68253c8a1e0eff9ff50437bcbd107","observation_id":"fe14dc20-04de-4e94-9e16-600890e0727c","resolution":{"observed_at":"2026-08-05T00:48:48.102460Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T00:48:50.608177Z","title":"Jacobs and Hanna Wallach","venue":null,"work_id":"0d772a3e-a6ad-48b8-bff0-d9de83eb7f2c","year":2021},"citing_paper":{"arxiv_id":"2608.02665","last_updated":"2026-08-01T22:28:31Z","snapshot_observed_at":"2026-08-14T14:09:23.946946Z","submitted_at":"2026-08-01T22:28:31Z","title":"Single Canonical Prompts Underestimate LLM Safety's Surface-Form Sensitivity","version":1},"reference_index":6,"source":"arxiv_source","source_observed_at":"2026-08-05T00:48:48.228849Z"},"links":{"citing_paper":"/paper/2608.02665"},"observation_digest":"sha256:69ffdc4a491eba373dabb7069595942e3c794882fa0bd0a61bb8dfc08a4cb416","observation_id":"6a825f54-2d85-4f97-bced-821b5569187d","resolution":{"observed_at":"2026-08-05T00:48:50.695454Z","resolver_source":"arxiv_id_nonexistent","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2401.16765","last_updated":"2024-01-30T06:04:04Z","snapshot_observed_at":"2026-08-13T04:32:04.658955Z","submitted_at":"2024-01-30T06:04:04Z","title":"A Cross-Language Investigation into Jailbreak Attacks in Large Language Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2401.16765","snapshot_observed_at":"2026-08-05T00:48:48.346153Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2608.02665","last_updated":"2026-08-01T22:28:31Z","snapshot_observed_at":"2026-08-14T14:09:23.946946Z","submitted_at":"2026-08-01T22:28:31Z","title":"Single Canonical Prompts Underestimate LLM Safety's Surface-Form Sensitivity","version":1},"reference_index":7,"source":"arxiv_source","source_observed_at":"2026-08-05T00:48:48.346153Z"},"links":{"cited_paper":"/paper/2401.16765","citing_paper":"/paper/2608.02665"},"observation_digest":"sha256:cb37d215f04d92c1bd6ee4dc38f71d29b7dc31290aa57aa259c4b87b2fff4695","observation_id":"784b503d-3cbf-4283-86cc-58e181a40db7","resolution":{"observed_at":"2026-08-05T00:48:48.346153Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2607.07097","last_updated":"2026-07-08T07:31:37Z","snapshot_observed_at":"2026-08-14T13:02:55.241554Z","submitted_at":"2026-07-08T07:31:37Z","title":"Operational Reframing and Approval-Framed Delegation in Multi-Agent LLM Safety","version":1},"cited_work":{"arxiv_id":"2607.07097","doi":null,"metadata_source":"pith","pith_arxiv_id":"2607.07097","snapshot_observed_at":"2026-08-05T00:48:50.245389Z","title":"Operational Reframing and Approval-Framed Delegation in Multi-Agent LLM Safety","venue":"cs.AI","work_id":"9ca2a8d1-32e2-4e3d-96fd-c2e0759afa59","year":2026},"citing_paper":{"arxiv_id":"2608.02665","last_updated":"2026-08-01T22:28:31Z","snapshot_observed_at":"2026-08-14T14:09:23.946946Z","submitted_at":"2026-08-01T22:28:31Z","title":"Single Canonical Prompts Underestimate LLM Safety's Surface-Form Sensitivity","version":1},"reference_index":8,"source":"arxiv_source","source_observed_at":"2026-08-05T00:48:48.474079Z"},"links":{"cited_paper":"/paper/2607.07097","citing_paper":"/paper/2608.02665"},"observation_digest":"sha256:75291dd4e27820136f168e71639923fc829b9410a653d9c4d5d7b5ffec2e5c4b","observation_id":"c1131312-66ab-401b-9424-f9a97a5eef6b","resolution":{"observed_at":"2026-08-05T00:48:50.397734Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T00:48:52.547964Z","title":null,"venue":null,"work_id":"801ae234-2f1f-424d-bd8b-8e37634c7786","year":2024},"citing_paper":{"arxiv_id":"2608.02665","last_updated":"2026-08-01T22:28:31Z","snapshot_observed_at":"2026-08-14T14:09:23.946946Z","submitted_at":"2026-08-01T22:28:31Z","title":"Single Canonical Prompts Underestimate LLM Safety's Surface-Form Sensitivity","version":1},"reference_index":9,"source":"arxiv_source","source_observed_at":"2026-08-05T00:48:48.573825Z"},"links":{"citing_paper":"/paper/2608.02665"},"observation_digest":"sha256:4dbf509283d8efd1202d5e0c33ad288a23fe4e84caa0cdb2ac2533a0ea794fce","observation_id":"46e4f696-0677-40f2-bc22-4e2c92e88b0d","resolution":{"observed_at":"2026-08-05T00:48:52.681403Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T00:48:52.290435Z","title":null,"venue":null,"work_id":"0bee7286-228d-402c-8d94-2eae7631c11f","year":2024},"citing_paper":{"arxiv_id":"2608.02665","last_updated":"2026-08-01T22:28:31Z","snapshot_observed_at":"2026-08-14T14:09:23.946946Z","submitted_at":"2026-08-01T22:28:31Z","title":"Single Canonical Prompts Underestimate LLM Safety's Surface-Form Sensitivity","version":1},"reference_index":10,"source":"arxiv_source","source_observed_at":"2026-08-05T00:48:48.689413Z"},"links":{"citing_paper":"/paper/2608.02665"},"observation_digest":"sha256:a01f3d900d488d91ab0be89ac3950454673a01bdc061e52d860c1137a7dc3e6d","observation_id":"bf59ab63-6167-4b78-957b-e628b03c71b0","resolution":{"observed_at":"2026-08-05T00:48:52.434370Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T00:48:51.975600Z","title":null,"venue":null,"work_id":"9a1f416f-c80d-466d-b4ce-b072a1216570","year":2024},"citing_paper":{"arxiv_id":"2608.02665","last_updated":"2026-08-01T22:28:31Z","snapshot_observed_at":"2026-08-14T14:09:23.946946Z","submitted_at":"2026-08-01T22:28:31Z","title":"Single Canonical Prompts Underestimate LLM Safety's Surface-Form Sensitivity","version":1},"reference_index":11,"source":"arxiv_source","source_observed_at":"2026-08-05T00:48:48.797993Z"},"links":{"citing_paper":"/paper/2608.02665"},"observation_digest":"sha256:ef448eb6621f02d0964e470f7806031982f734892bcdb7de08a721ab608bccad","observation_id":"ba4de435-e0d6-4f05-b7c2-f8a12de7a683","resolution":{"observed_at":"2026-08-05T00:48:52.149128Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T00:48:51.729758Z","title":null,"venue":null,"work_id":"de38fc33-3765-427a-b2bb-f478e87debb9","year":1993},"citing_paper":{"arxiv_id":"2608.02665","last_updated":"2026-08-01T22:28:31Z","snapshot_observed_at":"2026-08-14T14:09:23.946946Z","submitted_at":"2026-08-01T22:28:31Z","title":"Single Canonical Prompts Underestimate LLM Safety's Surface-Form Sensitivity","version":1},"reference_index":12,"source":"arxiv_source","source_observed_at":"2026-08-05T00:48:48.913829Z"},"links":{"citing_paper":"/paper/2608.02665"},"observation_digest":"sha256:388d766cfb43c58820f34b1ca7dd2681e620c0a40848fe48e312b9411a07c5ae","observation_id":"c39f7f01-617c-4c84-ad77-4574af70a24c","resolution":{"observed_at":"2026-08-05T00:48:51.827995Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T00:48:51.480949Z","title":null,"venue":null,"work_id":"4ef6c007-11b5-404e-aacc-1ea14b20abed","year":2024},"citing_paper":{"arxiv_id":"2608.02665","last_updated":"2026-08-01T22:28:31Z","snapshot_observed_at":"2026-08-14T14:09:23.946946Z","submitted_at":"2026-08-01T22:28:31Z","title":"Single Canonical Prompts Underestimate LLM Safety's Surface-Form Sensitivity","version":1},"reference_index":13,"source":"arxiv_source","source_observed_at":"2026-08-05T00:48:49.069998Z"},"links":{"citing_paper":"/paper/2608.02665"},"observation_digest":"sha256:566b122b88e3be0f427d7ae97a8b812adf79235a581ed224cf91241154a5bed5","observation_id":"ddfb7a64-a005-4b07-ae67-0b2cca66b80b","resolution":{"observed_at":"2026-08-05T00:48:51.587110Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2310.11324","last_updated":"2024-07-01T22:28:01Z","snapshot_observed_at":"2026-08-12T15:05:30.306144Z","submitted_at":"2023-10-17T15:03:30Z","title":"Quantifying Language Models' Sensitivity to Spurious Features in Prompt Design or: How I learned to start worrying about prompt formatting","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2310.11324","snapshot_observed_at":"2026-08-05T00:48:49.223511Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2608.02665","last_updated":"2026-08-01T22:28:31Z","snapshot_observed_at":"2026-08-14T14:09:23.946946Z","submitted_at":"2026-08-01T22:28:31Z","title":"Single Canonical Prompts Underestimate LLM Safety's Surface-Form Sensitivity","version":1},"reference_index":14,"source":"arxiv_source","source_observed_at":"2026-08-05T00:48:49.223511Z"},"links":{"cited_paper":"/paper/2310.11324","citing_paper":"/paper/2608.02665"},"observation_digest":"sha256:0aa332fca961d09a5f632b9db9c35c188c78d8ae3f0e68d44ded154eb19a2723","observation_id":"5c0b3f9e-5023-42cf-bfe0-6d65e5718c24","resolution":{"observed_at":"2026-08-05T00:48:49.223511Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2606.00448","last_updated":"2026-05-30T00:38:07Z","snapshot_observed_at":"2026-08-14T00:18:38.820521Z","submitted_at":"2026-05-30T00:38:07Z","title":"When Safe Skills Collide: Measuring Compositional Risk in Agent Skill Ecosystems","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2606.00448","snapshot_observed_at":"2026-08-05T00:48:49.304875Z","title":null,"venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2608.02665","last_updated":"2026-08-01T22:28:31Z","snapshot_observed_at":"2026-08-14T14:09:23.946946Z","submitted_at":"2026-08-01T22:28:31Z","title":"Single Canonical Prompts Underestimate LLM Safety's Surface-Form Sensitivity","version":1},"reference_index":15,"source":"arxiv_source","source_observed_at":"2026-08-05T00:48:49.304875Z"},"links":{"cited_paper":"/paper/2606.00448","citing_paper":"/paper/2608.02665"},"observation_digest":"sha256:0dea216288f47d90e32eb7741913ff0a300c8a2ecb959284aa074956e90b5976","observation_id":"cebaace7-c0f9-4320-b9e0-41c4c5bacbfc","resolution":{"observed_at":"2026-08-05T00:48:49.304875Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2310.02446","last_updated":"2024-01-27T22:54:52Z","snapshot_observed_at":"2026-08-13T01:25:06.346704Z","submitted_at":"2023-10-03T21:30:56Z","title":"Low-Resource Languages Jailbreak GPT-4","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2310.02446","snapshot_observed_at":"2026-08-05T00:48:49.383630Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2608.02665","last_updated":"2026-08-01T22:28:31Z","snapshot_observed_at":"2026-08-14T14:09:23.946946Z","submitted_at":"2026-08-01T22:28:31Z","title":"Single Canonical Prompts Underestimate LLM Safety's Surface-Form Sensitivity","version":1},"reference_index":16,"source":"arxiv_source","source_observed_at":"2026-08-05T00:48:49.383630Z"},"links":{"cited_paper":"/paper/2310.02446","citing_paper":"/paper/2608.02665"},"observation_digest":"sha256:1d4895e28ec8c3afa38ed7bff51e78811162d2284afe9aefc7a321d26e207dcf","observation_id":"71d8efd2-22c5-40c3-b32e-9750cd307da2","resolution":{"observed_at":"2026-08-05T00:48:49.383630Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T00:48:51.172215Z","title":null,"venue":null,"work_id":"e1de5a1c-a4a3-4899-a2c4-dfb8c057bc42","year":2025},"citing_paper":{"arxiv_id":"2608.02665","last_updated":"2026-08-01T22:28:31Z","snapshot_observed_at":"2026-08-14T14:09:23.946946Z","submitted_at":"2026-08-01T22:28:31Z","title":"Single Canonical Prompts Underestimate LLM Safety's Surface-Form Sensitivity","version":1},"reference_index":17,"source":"arxiv_source","source_observed_at":"2026-08-05T00:48:49.488227Z"},"links":{"citing_paper":"/paper/2608.02665"},"observation_digest":"sha256:31bd529f144a2c87d47924401b6990353281bc93e0e79db8b0a73447ec87430c","observation_id":"90c79157-601a-4a9c-b628-c8fb11fc3899","resolution":{"observed_at":"2026-08-05T00:48:51.352287Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2401.06373","last_updated":"2024-01-23T22:46:12Z","snapshot_observed_at":"2026-08-13T04:43:50.878930Z","submitted_at":"2024-01-12T16:13:24Z","title":"How Johnny Can Persuade LLMs to Jailbreak Them: Rethinking Persuasion to Challenge AI Safety by Humanizing LLMs","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2401.06373","snapshot_observed_at":"2026-08-05T00:48:49.605652Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2608.02665","last_updated":"2026-08-01T22:28:31Z","snapshot_observed_at":"2026-08-14T14:09:23.946946Z","submitted_at":"2026-08-01T22:28:31Z","title":"Single Canonical Prompts Underestimate LLM Safety's Surface-Form Sensitivity","version":1},"reference_index":18,"source":"arxiv_source","source_observed_at":"2026-08-05T00:48:49.605652Z"},"links":{"cited_paper":"/paper/2401.06373","citing_paper":"/paper/2608.02665"},"observation_digest":"sha256:0a36d2a50c1cf146de11faa22bb1eff86382e28def69f82e9cc2b23168ac0bee","observation_id":"5eb38f5c-d248-4d90-a46d-cb6fd5a2b453","resolution":{"observed_at":"2026-08-05T00:48:49.605652Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T00:48:50.888361Z","title":null,"venue":null,"work_id":"fcb10649-a9c0-4b73-8ee3-2c09110c8613","year":2026},"citing_paper":{"arxiv_id":"2608.02665","last_updated":"2026-08-01T22:28:31Z","snapshot_observed_at":"2026-08-14T14:09:23.946946Z","submitted_at":"2026-08-01T22:28:31Z","title":"Single Canonical Prompts Underestimate LLM Safety's Surface-Form Sensitivity","version":1},"reference_index":19,"source":"arxiv_source","source_observed_at":"2026-08-05T00:48:49.690266Z"},"links":{"citing_paper":"/paper/2608.02665"},"observation_digest":"sha256:47a1f9664ca5f91408ea2e92885fcabe93da5a9cbe5bb1da91cdacc6c4d3a2cf","observation_id":"8f71313a-8b27-43e3-8cfa-672f2f284fc4","resolution":{"observed_at":"2026-08-05T00:48:51.039113Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2606.00920","last_updated":"2026-05-30T23:03:05Z","snapshot_observed_at":"2026-08-11T00:36:59.739303Z","submitted_at":"2026-05-30T23:03:05Z","title":"Accuracy, Stability, and Repeated-Run Reliability of Large Language Models on Deterministic Programming Tasks","version":1},"cited_work":{"arxiv_id":"2606.00920","doi":null,"metadata_source":"pith","pith_arxiv_id":"2606.00920","snapshot_observed_at":"2026-08-05T00:48:49.928342Z","title":"Accuracy, Stability, and Repeated-Run Reliability of Large Language Models on Deterministic Programming Tasks","venue":"cs.LG","work_id":"8ee149c9-833b-45ce-8a04-357993d5c146","year":2026},"citing_paper":{"arxiv_id":"2608.02665","last_updated":"2026-08-01T22:28:31Z","snapshot_observed_at":"2026-08-14T14:09:23.946946Z","submitted_at":"2026-08-01T22:28:31Z","title":"Single Canonical Prompts Underestimate LLM Safety's Surface-Form Sensitivity","version":1},"reference_index":20,"source":"arxiv_source","source_observed_at":"2026-08-05T00:48:49.750627Z"},"links":{"cited_paper":"/paper/2606.00920","citing_paper":"/paper/2608.02665"},"observation_digest":"sha256:b7c26bca4c6a553c138e5777d25e81a67db6dbed0c1ee021159921edfc374380","observation_id":"e3c2cb12-e5d4-4d55-8a36-ee36640ae800","resolution":{"observed_at":"2026-08-05T00:48:50.091776Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2307.15043","last_updated":"2023-12-20T20:48:57Z","snapshot_observed_at":"2026-08-12T09:06:50.363435Z","submitted_at":"2023-07-27T17:49:12Z","title":"Universal and Transferable Adversarial Attacks on Aligned Language Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2307.15043","snapshot_observed_at":"2026-08-05T00:48:49.845907Z","title":"Zico Kolter, and Matt Fredrikson","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2608.02665","last_updated":"2026-08-01T22:28:31Z","snapshot_observed_at":"2026-08-14T14:09:23.946946Z","submitted_at":"2026-08-01T22:28:31Z","title":"Single Canonical Prompts Underestimate LLM Safety's Surface-Form Sensitivity","version":1},"reference_index":21,"source":"arxiv_source","source_observed_at":"2026-08-05T00:48:49.845907Z"},"links":{"cited_paper":"/paper/2307.15043","citing_paper":"/paper/2608.02665"},"observation_digest":"sha256:48b2fed7c4a20e6059ad91260546d23ca706920044e4e40752c38503931f100e","observation_id":"75d7b4ee-09fa-432f-8c66-4c1a3dd6297d","resolution":{"observed_at":"2026-08-05T00:48:49.845907Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"paper":{"arxiv_id":"2608.02665","last_updated":"2026-08-01T22:28:31Z","latest_version":1,"primary_category":"cs.CR","snapshot_observed_at":"2026-08-14T14:09:23.946946Z","submitted_at":"2026-08-01T22:28:31Z","title":"Single Canonical Prompts Underestimate LLM Safety's Surface-Form Sensitivity"},"reference_resolution":{"displayed":21,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":17,"verified_exact":3,"verified_fuzzy":1},"total_outbound_references":21},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"thesis":"As of 14 August 2026, this Paper Citation Record lists 21 of 21 outbound references and 0 inbound Pith citation observations for arXiv:2608.02665."}