{"as_of":"2026-08-21T09:37:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:e985a1592bccf2cdb0f73007ea32cd0e1b53dc21292322c0f930024defe1c026","coverage":[{"denominator":47,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":47,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-15T20:45:55.362359Z","state":"measured"},{"denominator":47,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":47,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-21T06:32:19.484+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2505.12060/citation-record","integrity":"/paper/2505.12060/integrity","json":"/paper/2505.12060/citation-record.json","paper":"/paper/2505.12060"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T20:45:55.159478Z","title":"online\" 'onlinestring :=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2505.12060","last_updated":"2025-05-17T15:54:52Z","snapshot_observed_at":"2026-08-19T23:36:41.256008Z","submitted_at":"2025-05-17T15:54:52Z","title":"Why Not Act on What You Know? Unleashing Safety Potential of LLMs via Self-Aware Guard Enhancement","version":1},"reference_index":1,"source":"arxiv_source","source_observed_at":"2026-08-15T20:45:55.159478Z"},"links":{"citing_paper":"/paper/2505.12060"},"observation_digest":"sha256:cc8a65af61fb639d71c819032e7082ea4e7cd9435978d6c7d165f4ffdd370eaa","observation_id":"5f5ca2fb-bb12-474c-ac85-7b04b62ded77","resolution":{"observed_at":"2026-08-15T20:45:55.159478Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T20:45:55.164792Z","title":"write newline","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2505.12060","last_updated":"2025-05-17T15:54:52Z","snapshot_observed_at":"2026-08-19T23:36:41.256008Z","submitted_at":"2025-05-17T15:54:52Z","title":"Why Not Act on What You Know? Unleashing Safety Potential of LLMs via Self-Aware Guard Enhancement","version":1},"reference_index":2,"source":"arxiv_source","source_observed_at":"2026-08-15T20:45:55.164792Z"},"links":{"citing_paper":"/paper/2505.12060"},"observation_digest":"sha256:b4b9a07947f6eea33497f908fd9eebe4b4a5eb633d459878856d6ef0ba3c5d5b","observation_id":"7b3634ff-3a7f-4799-831b-b9a59b111d77","resolution":{"observed_at":"2026-08-15T20:45:55.164792Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2308.14132","last_updated":"2023-11-07T03:30:15Z","snapshot_observed_at":"2026-08-15T21:55:47.604051Z","submitted_at":"2023-08-27T15:20:06Z","title":"Detecting Language Model Attacks with Perplexity","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2308.14132","snapshot_observed_at":"2026-08-15T20:45:55.174359Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.12060","last_updated":"2025-05-17T15:54:52Z","snapshot_observed_at":"2026-08-19T23:36:41.256008Z","submitted_at":"2025-05-17T15:54:52Z","title":"Why Not Act on What You Know? Unleashing Safety Potential of LLMs via Self-Aware Guard Enhancement","version":1},"reference_index":4,"source":"arxiv_source","source_observed_at":"2026-08-15T20:45:55.174359Z"},"links":{"cited_paper":"/paper/2308.14132","citing_paper":"/paper/2505.12060"},"observation_digest":"sha256:3de9494ffdb58f641b583e8e8de7ff8e416142ccad66635d3372ad3f4fa72b58","observation_id":"d0b12999-6932-43f8-b9ce-e7d29cc44176","resolution":{"observed_at":"2026-08-15T20:45:55.174359Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T20:45:55.178874Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.12060","last_updated":"2025-05-17T15:54:52Z","snapshot_observed_at":"2026-08-19T23:36:41.256008Z","submitted_at":"2025-05-17T15:54:52Z","title":"Why Not Act on What You Know? Unleashing Safety Potential of LLMs via Self-Aware Guard Enhancement","version":1},"reference_index":5,"source":"arxiv_source","source_observed_at":"2026-08-15T20:45:55.178874Z"},"links":{"citing_paper":"/paper/2505.12060"},"observation_digest":"sha256:a7de8d4af4870c26b9aa0badfdd55b638cd1880f79c7cce9273a5435b3aa3a0f","observation_id":"3cd3e906-c155-48d7-a3c5-abfe4e6e4ba3","resolution":{"observed_at":"2026-08-15T20:45:55.178874Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2309.14348","last_updated":"2024-06-12T00:27:06Z","snapshot_observed_at":"2026-08-18T09:36:32.490699Z","submitted_at":"2023-09-18T02:07:22Z","title":"Defending Against Alignment-Breaking Attacks via Robustly Aligned LLM","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2309.14348","snapshot_observed_at":"2026-08-15T20:45:55.183166Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.12060","last_updated":"2025-05-17T15:54:52Z","snapshot_observed_at":"2026-08-19T23:36:41.256008Z","submitted_at":"2025-05-17T15:54:52Z","title":"Why Not Act on What You Know? Unleashing Safety Potential of LLMs via Self-Aware Guard Enhancement","version":1},"reference_index":6,"source":"arxiv_source","source_observed_at":"2026-08-15T20:45:55.183166Z"},"links":{"cited_paper":"/paper/2309.14348","citing_paper":"/paper/2505.12060"},"observation_digest":"sha256:40af49153ecb023589f57e12200c1989acf8fac34ce6c30429289d08bdc0d9d0","observation_id":"21f0dac6-028c-4fa4-8fe6-48587e7016a1","resolution":{"observed_at":"2026-08-15T20:45:55.183166Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2404.01318","last_updated":"2024-10-31T22:26:40Z","snapshot_observed_at":"2026-08-11T16:28:21.917686Z","submitted_at":"2024-03-28T02:44:02Z","title":"JailbreakBench: An Open Robustness Benchmark for Jailbreaking Large Language Models","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2404.01318","snapshot_observed_at":"2026-08-15T20:45:55.188436Z","title":"Pappas, Florian Tramer, Hamed Hassani, and Eric Wong","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.12060","last_updated":"2025-05-17T15:54:52Z","snapshot_observed_at":"2026-08-19T23:36:41.256008Z","submitted_at":"2025-05-17T15:54:52Z","title":"Why Not Act on What You Know? Unleashing Safety Potential of LLMs via Self-Aware Guard Enhancement","version":1},"reference_index":7,"source":"arxiv_source","source_observed_at":"2026-08-15T20:45:55.188436Z"},"links":{"cited_paper":"/paper/2404.01318","citing_paper":"/paper/2505.12060"},"observation_digest":"sha256:9495523b44a979cf03a7996275b0de9ef1c735b6dae9b084a986c1891094f009","observation_id":"f0bd4047-d1a1-4601-8414-9f581ac26c13","resolution":{"observed_at":"2026-08-15T20:45:55.188436Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2310.08419","last_updated":"2024-07-18T18:24:57Z","snapshot_observed_at":"2026-08-16T13:08:51.920120Z","submitted_at":"2023-10-12T15:38:28Z","title":"Jailbreaking Black Box Large Language Models in Twenty Queries","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2310.08419","snapshot_observed_at":"2026-08-15T20:45:55.193949Z","title":"Pappas, and Eric Wong","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.12060","last_updated":"2025-05-17T15:54:52Z","snapshot_observed_at":"2026-08-19T23:36:41.256008Z","submitted_at":"2025-05-17T15:54:52Z","title":"Why Not Act on What You Know? Unleashing Safety Potential of LLMs via Self-Aware Guard Enhancement","version":1},"reference_index":8,"source":"arxiv_source","source_observed_at":"2026-08-15T20:45:55.193949Z"},"links":{"cited_paper":"/paper/2310.08419","citing_paper":"/paper/2505.12060"},"observation_digest":"sha256:2ec295ec14f36abec4a6cbe22e4d75e47cb63f954c35f55d5d7446015337d7f0","observation_id":"9f548a7b-3fc5-4eac-9ff3-3dedfacf0622","resolution":{"observed_at":"2026-08-15T20:45:55.193949Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T20:45:55.199906Z","title":"Christiano, Jan Leike, Tom B","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2505.12060","last_updated":"2025-05-17T15:54:52Z","snapshot_observed_at":"2026-08-19T23:36:41.256008Z","submitted_at":"2025-05-17T15:54:52Z","title":"Why Not Act on What You Know? Unleashing Safety Potential of LLMs via Self-Aware Guard Enhancement","version":1},"reference_index":9,"source":"arxiv_source","source_observed_at":"2026-08-15T20:45:55.199906Z"},"links":{"citing_paper":"/paper/2505.12060"},"observation_digest":"sha256:ea644068bd7d49c75fa3d0c095567bcecc2ea97c29e1cf2f12e2778b0d337905","observation_id":"9c3988a0-6d84-435c-9019-45aa0021fcf2","resolution":{"observed_at":"2026-08-15T20:45:55.199906Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2110.14168","last_updated":"2021-11-18T00:23:45Z","snapshot_observed_at":"2026-08-14T02:43:01.480086Z","submitted_at":"2021-10-27T04:49:45Z","title":"Training Verifiers to Solve Math Word Problems","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2110.14168","snapshot_observed_at":"2026-08-15T20:45:55.204727Z","title":null,"venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2505.12060","last_updated":"2025-05-17T15:54:52Z","snapshot_observed_at":"2026-08-19T23:36:41.256008Z","submitted_at":"2025-05-17T15:54:52Z","title":"Why Not Act on What You Know? Unleashing Safety Potential of LLMs via Self-Aware Guard Enhancement","version":1},"reference_index":10,"source":"arxiv_source","source_observed_at":"2026-08-15T20:45:55.204727Z"},"links":{"cited_paper":"/paper/2110.14168","citing_paper":"/paper/2505.12060"},"observation_digest":"sha256:be4c780518a25dfba8a32e620744319cd852f38d8bb2767c2db48b0bf86d31a9","observation_id":"85a10d4a-ed63-4aa5-937e-582dc1ceeede","resolution":{"observed_at":"2026-08-15T20:45:55.204727Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T20:45:55.209718Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.12060","last_updated":"2025-05-17T15:54:52Z","snapshot_observed_at":"2026-08-19T23:36:41.256008Z","submitted_at":"2025-05-17T15:54:52Z","title":"Why Not Act on What You Know? Unleashing Safety Potential of LLMs via Self-Aware Guard Enhancement","version":1},"reference_index":11,"source":"arxiv_source","source_observed_at":"2026-08-15T20:45:55.209718Z"},"links":{"citing_paper":"/paper/2505.12060"},"observation_digest":"sha256:e946e797a3204705f3177bcb7b118bf91db8bc21d0e837d8f707205b017cf665","observation_id":"41ae1dcd-99fb-4380-b91e-9b055704f53e","resolution":{"observed_at":"2026-08-15T20:45:55.209718Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2402.09283","last_updated":"2024-03-27T13:55:14Z","snapshot_observed_at":"2026-08-18T07:38:05.119659Z","submitted_at":"2024-02-14T16:14:03Z","title":"Attacks, Defenses and Evaluations for LLM Conversation Safety: A Survey","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.09283","snapshot_observed_at":"2026-08-15T20:45:55.214729Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.12060","last_updated":"2025-05-17T15:54:52Z","snapshot_observed_at":"2026-08-19T23:36:41.256008Z","submitted_at":"2025-05-17T15:54:52Z","title":"Why Not Act on What You Know? Unleashing Safety Potential of LLMs via Self-Aware Guard Enhancement","version":1},"reference_index":12,"source":"arxiv_source","source_observed_at":"2026-08-15T20:45:55.214729Z"},"links":{"cited_paper":"/paper/2402.09283","citing_paper":"/paper/2505.12060"},"observation_digest":"sha256:d7ed6599c46a6420699b78de920819123b0b7cbdfc10822a6450fc57343ac3e9","observation_id":"f94cd4ae-7843-4f5f-b1cb-2dccc3688720","resolution":{"observed_at":"2026-08-15T20:45:55.214729Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2407.21783","last_updated":"2024-11-23T23:27:33Z","snapshot_observed_at":"2026-08-13T17:20:44.002518Z","submitted_at":"2024-07-31T17:54:27Z","title":"The Llama 3 Herd of Models","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2407.21783","snapshot_observed_at":"2026-08-15T20:45:55.219549Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.12060","last_updated":"2025-05-17T15:54:52Z","snapshot_observed_at":"2026-08-19T23:36:41.256008Z","submitted_at":"2025-05-17T15:54:52Z","title":"Why Not Act on What You Know? Unleashing Safety Potential of LLMs via Self-Aware Guard Enhancement","version":1},"reference_index":13,"source":"arxiv_source","source_observed_at":"2026-08-15T20:45:55.219549Z"},"links":{"cited_paper":"/paper/2407.21783","citing_paper":"/paper/2505.12060"},"observation_digest":"sha256:fe9eaeb0738fce48c4bfe247cbfd3dcd6236e7fd600d0d5ab062ee56f729af54","observation_id":"9db4da0b-733e-4971-a04f-ca46c8ffe92f","resolution":{"observed_at":"2026-08-15T20:45:55.219549Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2404.16244","last_updated":"2024-04-28T18:28:33Z","snapshot_observed_at":"2026-08-18T15:32:22.623693Z","submitted_at":"2024-04-24T23:18:46Z","title":"The Ethics of Advanced AI Assistants","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2404.16244","snapshot_observed_at":"2026-08-15T20:45:55.223921Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.12060","last_updated":"2025-05-17T15:54:52Z","snapshot_observed_at":"2026-08-19T23:36:41.256008Z","submitted_at":"2025-05-17T15:54:52Z","title":"Why Not Act on What You Know? Unleashing Safety Potential of LLMs via Self-Aware Guard Enhancement","version":1},"reference_index":14,"source":"arxiv_source","source_observed_at":"2026-08-15T20:45:55.223921Z"},"links":{"cited_paper":"/paper/2404.16244","citing_paper":"/paper/2505.12060"},"observation_digest":"sha256:403d54779e506a9b5f4afb2cffc43bc4e3f79773ae749712084373d4ced45482","observation_id":"00ce8e54-3942-40b9-bb4d-fdd9659524cf","resolution":{"observed_at":"2026-08-15T20:45:55.223921Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2501.12948","last_updated":"2026-01-04T03:57:36Z","snapshot_observed_at":"2026-08-15T12:33:55.451951Z","submitted_at":"2025-01-22T15:19:35Z","title":"DeepSeek-R1: Incentivizing Reasoning Capability in LLMs via Reinforcement Learning","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2501.12948","snapshot_observed_at":"2026-08-15T20:45:55.228774Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2505.12060","last_updated":"2025-05-17T15:54:52Z","snapshot_observed_at":"2026-08-19T23:36:41.256008Z","submitted_at":"2025-05-17T15:54:52Z","title":"Why Not Act on What You Know? Unleashing Safety Potential of LLMs via Self-Aware Guard Enhancement","version":1},"reference_index":15,"source":"arxiv_source","source_observed_at":"2026-08-15T20:45:55.228774Z"},"links":{"cited_paper":"/paper/2501.12948","citing_paper":"/paper/2505.12060"},"observation_digest":"sha256:6ad7c460509d7309f2ce93aec85cd7c6067adb4c407fe85a6d578104834a321b","observation_id":"e5e70198-796f-40b0-b3e4-dd8c3fb3dfc5","resolution":{"observed_at":"2026-08-15T20:45:55.228774Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2009.03300","last_updated":"2021-01-12T18:57:11Z","snapshot_observed_at":"2026-08-13T20:44:28.824685Z","submitted_at":"2020-09-07T17:59:25Z","title":"Measuring Massive Multitask Language Understanding","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2009.03300","snapshot_observed_at":"2026-08-15T20:45:55.233816Z","title":null,"venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2505.12060","last_updated":"2025-05-17T15:54:52Z","snapshot_observed_at":"2026-08-19T23:36:41.256008Z","submitted_at":"2025-05-17T15:54:52Z","title":"Why Not Act on What You Know? Unleashing Safety Potential of LLMs via Self-Aware Guard Enhancement","version":1},"reference_index":16,"source":"arxiv_source","source_observed_at":"2026-08-15T20:45:55.233816Z"},"links":{"cited_paper":"/paper/2009.03300","citing_paper":"/paper/2505.12060"},"observation_digest":"sha256:3a23c7ac657a6765db01a4b43b823df03619d66e425f98d4ddb961f38d042d44","observation_id":"9a67fc54-b43f-43c3-a5b4-b11b99e9e51e","resolution":{"observed_at":"2026-08-15T20:45:55.233816Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2309.00614","last_updated":"2023-09-04T17:47:36Z","snapshot_observed_at":"2026-07-06T16:13:23.343694Z","submitted_at":"2023-09-01T17:59:44Z","title":"Baseline Defenses for Adversarial Attacks Against Aligned Language Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2309.00614","snapshot_observed_at":"2026-08-15T20:45:55.237655Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.12060","last_updated":"2025-05-17T15:54:52Z","snapshot_observed_at":"2026-08-19T23:36:41.256008Z","submitted_at":"2025-05-17T15:54:52Z","title":"Why Not Act on What You Know? Unleashing Safety Potential of LLMs via Self-Aware Guard Enhancement","version":1},"reference_index":17,"source":"arxiv_source","source_observed_at":"2026-08-15T20:45:55.237655Z"},"links":{"cited_paper":"/paper/2309.00614","citing_paper":"/paper/2505.12060"},"observation_digest":"sha256:cd71fdcd310a5b0deb3b75afb2789cb1ed47b72ac5c2a87729273d43f43c8d57","observation_id":"24369157-fdf1-4369-9ea4-7edcf20d8af4","resolution":{"observed_at":"2026-08-15T20:45:55.237655Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T20:45:55.241736Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.12060","last_updated":"2025-05-17T15:54:52Z","snapshot_observed_at":"2026-08-19T23:36:41.256008Z","submitted_at":"2025-05-17T15:54:52Z","title":"Why Not Act on What You Know? Unleashing Safety Potential of LLMs via Self-Aware Guard Enhancement","version":1},"reference_index":18,"source":"arxiv_source","source_observed_at":"2026-08-15T20:45:55.241736Z"},"links":{"citing_paper":"/paper/2505.12060"},"observation_digest":"sha256:f5a11aac11f457b78b25941ece0beabbef6f5e841208ec8fe165019296e46439","observation_id":"b96e56c8-99b4-4f6f-919d-da1aebb16906","resolution":{"observed_at":"2026-08-15T20:45:55.241736Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T20:45:55.841912Z","title":"Buckley, Jason Phang, Samuel R","venue":null,"work_id":"7ca93914-1649-494f-ab9c-9fd9f9f9ae80","year":2023},"citing_paper":{"arxiv_id":"2505.12060","last_updated":"2025-05-17T15:54:52Z","snapshot_observed_at":"2026-08-19T23:36:41.256008Z","submitted_at":"2025-05-17T15:54:52Z","title":"Why Not Act on What You Know? Unleashing Safety Potential of LLMs via Self-Aware Guard Enhancement","version":1},"reference_index":19,"source":"arxiv_source","source_observed_at":"2026-08-15T20:45:55.245600Z"},"links":{"citing_paper":"/paper/2505.12060"},"observation_digest":"sha256:522c29fc48a7269bf343c9538ec223413c2a6bddb10b839fb436f7ded643c53c","observation_id":"2d314247-71de-421a-9805-f6aa364a32b3","resolution":{"observed_at":"2026-08-15T20:45:55.845907Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2311.03191","last_updated":"2024-11-28T13:43:50Z","snapshot_observed_at":"2026-08-18T06:50:23.685098Z","submitted_at":"2023-11-06T15:29:30Z","title":"DeepInception: Hypnotize Large Language Model to Be Jailbreaker","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2311.03191","snapshot_observed_at":"2026-08-15T20:45:55.249621Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.12060","last_updated":"2025-05-17T15:54:52Z","snapshot_observed_at":"2026-08-19T23:36:41.256008Z","submitted_at":"2025-05-17T15:54:52Z","title":"Why Not Act on What You Know? Unleashing Safety Potential of LLMs via Self-Aware Guard Enhancement","version":1},"reference_index":20,"source":"arxiv_source","source_observed_at":"2026-08-15T20:45:55.249621Z"},"links":{"cited_paper":"/paper/2311.03191","citing_paper":"/paper/2505.12060"},"observation_digest":"sha256:1bfd073daf600ef16fad783a8b4d204f0185e62aef0ff8004f6dc3757d5c6517","observation_id":"051b2a5a-2b35-45c1-8767-fa7a6da36ecd","resolution":{"observed_at":"2026-08-15T20:45:55.249621Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T20:45:55.253570Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.12060","last_updated":"2025-05-17T15:54:52Z","snapshot_observed_at":"2026-08-19T23:36:41.256008Z","submitted_at":"2025-05-17T15:54:52Z","title":"Why Not Act on What You Know? Unleashing Safety Potential of LLMs via Self-Aware Guard Enhancement","version":1},"reference_index":21,"source":"arxiv_source","source_observed_at":"2026-08-15T20:45:55.253570Z"},"links":{"citing_paper":"/paper/2505.12060"},"observation_digest":"sha256:f0422710836ce32381676eda0185aea0852fa0ebb524f76941179e31d52f65dc","observation_id":"f4d2ec25-105a-494a-b06d-c3993c108f27","resolution":{"observed_at":"2026-08-15T20:45:55.253570Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T20:45:55.822148Z","title":null,"venue":null,"work_id":"640373ee-a92a-41f6-b8a0-b0c5ae44cae3","year":2024},"citing_paper":{"arxiv_id":"2505.12060","last_updated":"2025-05-17T15:54:52Z","snapshot_observed_at":"2026-08-19T23:36:41.256008Z","submitted_at":"2025-05-17T15:54:52Z","title":"Why Not Act on What You Know? Unleashing Safety Potential of LLMs via Self-Aware Guard Enhancement","version":1},"reference_index":22,"source":"arxiv_source","source_observed_at":"2026-08-15T20:45:55.257358Z"},"links":{"citing_paper":"/paper/2505.12060"},"observation_digest":"sha256:d12984c0296ade78786080a27f1a22c1a7c1331803298e57f82c26ffac6e2701","observation_id":"76963d67-9297-4349-8e49-f749002a0979","resolution":{"observed_at":"2026-08-15T20:45:55.826768Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2406.10794","last_updated":"2024-12-02T21:48:47Z","snapshot_observed_at":"2026-08-18T00:52:09.536569Z","submitted_at":"2024-06-16T03:38:48Z","title":"Towards Understanding Jailbreak Attacks in LLMs: A Representation Space Analysis","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2406.10794","snapshot_observed_at":"2026-08-15T20:45:55.261508Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.12060","last_updated":"2025-05-17T15:54:52Z","snapshot_observed_at":"2026-08-19T23:36:41.256008Z","submitted_at":"2025-05-17T15:54:52Z","title":"Why Not Act on What You Know? Unleashing Safety Potential of LLMs via Self-Aware Guard Enhancement","version":1},"reference_index":23,"source":"arxiv_source","source_observed_at":"2026-08-15T20:45:55.261508Z"},"links":{"cited_paper":"/paper/2406.10794","citing_paper":"/paper/2505.12060"},"observation_digest":"sha256:50c927f1bcfa33f30e1c8614095b623e49fc7b4a6a6acf5e7477cc2d58193994","observation_id":"27c125a0-efac-4f97-aca5-bd1986b51276","resolution":{"observed_at":"2026-08-15T20:45:55.261508Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T20:45:55.265548Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.12060","last_updated":"2025-05-17T15:54:52Z","snapshot_observed_at":"2026-08-19T23:36:41.256008Z","submitted_at":"2025-05-17T15:54:52Z","title":"Why Not Act on What You Know? Unleashing Safety Potential of LLMs via Self-Aware Guard Enhancement","version":1},"reference_index":24,"source":"arxiv_source","source_observed_at":"2026-08-15T20:45:55.265548Z"},"links":{"citing_paper":"/paper/2505.12060"},"observation_digest":"sha256:e9d6821458aab139b1d7f4049989f1d4a1d27aa42ae1378b2c813ae170a63b24","observation_id":"689c87a8-a493-457f-a151-30b5f9fab1dc","resolution":{"observed_at":"2026-08-15T20:45:55.265548Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2303.08774","last_updated":"2024-03-04T06:01:33Z","snapshot_observed_at":"2026-08-17T09:58:46.058102Z","submitted_at":"2023-03-15T17:15:04Z","title":"GPT-4 Technical Report","version":6},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2303.08774","snapshot_observed_at":"2026-08-15T20:45:55.269328Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.12060","last_updated":"2025-05-17T15:54:52Z","snapshot_observed_at":"2026-08-19T23:36:41.256008Z","submitted_at":"2025-05-17T15:54:52Z","title":"Why Not Act on What You Know? Unleashing Safety Potential of LLMs via Self-Aware Guard Enhancement","version":1},"reference_index":25,"source":"arxiv_source","source_observed_at":"2026-08-15T20:45:55.269328Z"},"links":{"cited_paper":"/paper/2303.08774","citing_paper":"/paper/2505.12060"},"observation_digest":"sha256:873a009ac16f6d462b7bf15cad6246ccacca68f554bb4d6e4bb4be798927838f","observation_id":"226b1c8b-c92b-4e19-a3a8-a5a52ad963c8","resolution":{"observed_at":"2026-08-15T20:45:55.269328Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T20:45:55.800987Z","title":null,"venue":null,"work_id":"f08be64b-6a3b-4d09-9457-dddbbab001ff","year":2025},"citing_paper":{"arxiv_id":"2505.12060","last_updated":"2025-05-17T15:54:52Z","snapshot_observed_at":"2026-08-19T23:36:41.256008Z","submitted_at":"2025-05-17T15:54:52Z","title":"Why Not Act on What You Know? Unleashing Safety Potential of LLMs via Self-Aware Guard Enhancement","version":1},"reference_index":26,"source":"arxiv_source","source_observed_at":"2026-08-15T20:45:55.272893Z"},"links":{"citing_paper":"/paper/2505.12060"},"observation_digest":"sha256:60f8c40f8d057fd9344f4b0694227aec897d154a5dbca0cf2b29466b7390990f","observation_id":"f8338340-6c13-4c01-9fe8-0cd385686949","resolution":{"observed_at":"2026-08-15T20:45:55.805968Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2308.07308","last_updated":"2024-05-02T14:28:39Z","snapshot_observed_at":"2026-08-20T05:22:16.665208Z","submitted_at":"2023-08-14T17:54:10Z","title":"LLM Self Defense: By Self Examination, LLMs Know They Are Being Tricked","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2308.07308","snapshot_observed_at":"2026-08-15T20:45:55.276673Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.12060","last_updated":"2025-05-17T15:54:52Z","snapshot_observed_at":"2026-08-19T23:36:41.256008Z","submitted_at":"2025-05-17T15:54:52Z","title":"Why Not Act on What You Know? Unleashing Safety Potential of LLMs via Self-Aware Guard Enhancement","version":1},"reference_index":27,"source":"arxiv_source","source_observed_at":"2026-08-15T20:45:55.276673Z"},"links":{"cited_paper":"/paper/2308.07308","citing_paper":"/paper/2505.12060"},"observation_digest":"sha256:bff6e37cb02bcfc51d919bcf7d05b7a900ae9e7590b4bceb5fc9f5ee726de4eb","observation_id":"a8464431-916f-4204-8d0d-7c8d97e59d59","resolution":{"observed_at":"2026-08-15T20:45:55.276673Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2412.15115","last_updated":"2025-01-03T02:18:21Z","snapshot_observed_at":"2026-08-17T18:50:07.059564Z","submitted_at":"2024-12-19T17:56:09Z","title":"Qwen2.5 Technical Report","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2412.15115","snapshot_observed_at":"2026-08-15T20:45:55.281083Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2505.12060","last_updated":"2025-05-17T15:54:52Z","snapshot_observed_at":"2026-08-19T23:36:41.256008Z","submitted_at":"2025-05-17T15:54:52Z","title":"Why Not Act on What You Know? Unleashing Safety Potential of LLMs via Self-Aware Guard Enhancement","version":1},"reference_index":28,"source":"arxiv_source","source_observed_at":"2026-08-15T20:45:55.281083Z"},"links":{"cited_paper":"/paper/2412.15115","citing_paper":"/paper/2505.12060"},"observation_digest":"sha256:0b42f7cb894afba6bab87e129598d247a6fe3427d7bacec407747aff603df019","observation_id":"9820e6e7-89f9-41bb-8760-54975fc5fc25","resolution":{"observed_at":"2026-08-15T20:45:55.281083Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T20:45:55.284916Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.12060","last_updated":"2025-05-17T15:54:52Z","snapshot_observed_at":"2026-08-19T23:36:41.256008Z","submitted_at":"2025-05-17T15:54:52Z","title":"Why Not Act on What You Know? Unleashing Safety Potential of LLMs via Self-Aware Guard Enhancement","version":1},"reference_index":29,"source":"arxiv_source","source_observed_at":"2026-08-15T20:45:55.284916Z"},"links":{"citing_paper":"/paper/2505.12060"},"observation_digest":"sha256:7eaf565ea3a7109232ddae9c590a7cd237a539d7035db31cbf8e30d4bb1e7ef7","observation_id":"d4a222ed-31f7-49ee-8ec7-1168988832d5","resolution":{"observed_at":"2026-08-15T20:45:55.284916Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T20:45:55.787560Z","title":"do anything now","venue":null,"work_id":"6dc4bbfe-0779-4b78-858f-4f89d908ba06","year":2023},"citing_paper":{"arxiv_id":"2505.12060","last_updated":"2025-05-17T15:54:52Z","snapshot_observed_at":"2026-08-19T23:36:41.256008Z","submitted_at":"2025-05-17T15:54:52Z","title":"Why Not Act on What You Know? Unleashing Safety Potential of LLMs via Self-Aware Guard Enhancement","version":1},"reference_index":30,"source":"arxiv_source","source_observed_at":"2026-08-15T20:45:55.288831Z"},"links":{"citing_paper":"/paper/2505.12060"},"observation_digest":"sha256:9d9e2c4d8c054c2a6c600a08108aa80e8617af0c1e0d837dd5e792bf85668ee3","observation_id":"664885f0-8c54-405a-994f-33af0ee3186e","resolution":{"observed_at":"2026-08-15T20:45:55.791478Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2408.00118","last_updated":"2024-10-02T15:22:49Z","snapshot_observed_at":"2026-08-21T05:15:28.840279Z","submitted_at":"2024-07-31T19:13:07Z","title":"Gemma 2: Improving Open Language Models at a Practical Size","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2408.00118","snapshot_observed_at":"2026-08-15T20:45:55.293139Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.12060","last_updated":"2025-05-17T15:54:52Z","snapshot_observed_at":"2026-08-19T23:36:41.256008Z","submitted_at":"2025-05-17T15:54:52Z","title":"Why Not Act on What You Know? Unleashing Safety Potential of LLMs via Self-Aware Guard Enhancement","version":1},"reference_index":31,"source":"arxiv_source","source_observed_at":"2026-08-15T20:45:55.293139Z"},"links":{"cited_paper":"/paper/2408.00118","citing_paper":"/paper/2505.12060"},"observation_digest":"sha256:562c31d653dd4d1f41041a5fa1d0ed6a15cea8621bebe8ceadd30d79bed95b25","observation_id":"97929627-fe81-4ea4-bc8b-701da48999f6","resolution":{"observed_at":"2026-08-15T20:45:55.293139Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T20:45:55.296693Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.12060","last_updated":"2025-05-17T15:54:52Z","snapshot_observed_at":"2026-08-19T23:36:41.256008Z","submitted_at":"2025-05-17T15:54:52Z","title":"Why Not Act on What You Know? Unleashing Safety Potential of LLMs via Self-Aware Guard Enhancement","version":1},"reference_index":32,"source":"arxiv_source","source_observed_at":"2026-08-15T20:45:55.296693Z"},"links":{"citing_paper":"/paper/2505.12060"},"observation_digest":"sha256:cf594ce7648bff47c4e46d0c8099360a745f97c3aa0c6009373d8a4d3a98fd27","observation_id":"de251238-8b88-4a7d-a869-d2776c500b30","resolution":{"observed_at":"2026-08-15T20:45:55.296693Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T20:45:55.768569Z","title":null,"venue":null,"work_id":"15f0c99f-0a39-49df-a439-7b6f1af39799","year":2022},"citing_paper":{"arxiv_id":"2505.12060","last_updated":"2025-05-17T15:54:52Z","snapshot_observed_at":"2026-08-19T23:36:41.256008Z","submitted_at":"2025-05-17T15:54:52Z","title":"Why Not Act on What You Know? Unleashing Safety Potential of LLMs via Self-Aware Guard Enhancement","version":1},"reference_index":33,"source":"arxiv_source","source_observed_at":"2026-08-15T20:45:55.300335Z"},"links":{"citing_paper":"/paper/2505.12060"},"observation_digest":"sha256:637e312a624b58babbae57b316e8c5e4b0ba5a3fb247d1d5d00683259035ba89","observation_id":"7eb52288-476f-4e6d-b3fd-d833ec2325f7","resolution":{"observed_at":"2026-08-15T20:45:55.772534Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T20:45:55.756430Z","title":null,"venue":null,"work_id":"1da42c27-609c-43f5-94d1-fbc536e4e5a3","year":2024},"citing_paper":{"arxiv_id":"2505.12060","last_updated":"2025-05-17T15:54:52Z","snapshot_observed_at":"2026-08-19T23:36:41.256008Z","submitted_at":"2025-05-17T15:54:52Z","title":"Why Not Act on What You Know? Unleashing Safety Potential of LLMs via Self-Aware Guard Enhancement","version":1},"reference_index":34,"source":"arxiv_source","source_observed_at":"2026-08-15T20:45:55.303986Z"},"links":{"citing_paper":"/paper/2505.12060"},"observation_digest":"sha256:00bb57bf61b84b00fcfd6a06c463d18d528cc4eda777e71637976c909e2b3fe0","observation_id":"505700fc-08fe-42b2-868a-0df040fe0d5e","resolution":{"observed_at":"2026-08-15T20:45:55.760377Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T20:45:55.307537Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.12060","last_updated":"2025-05-17T15:54:52Z","snapshot_observed_at":"2026-08-19T23:36:41.256008Z","submitted_at":"2025-05-17T15:54:52Z","title":"Why Not Act on What You Know? Unleashing Safety Potential of LLMs via Self-Aware Guard Enhancement","version":1},"reference_index":35,"source":"arxiv_source","source_observed_at":"2026-08-15T20:45:55.307537Z"},"links":{"citing_paper":"/paper/2505.12060"},"observation_digest":"sha256:80c18f3e2ef571f88ba911e66d7beeecea5bd1d3807771ede1d90511f39e38a2","observation_id":"97e70e77-2b67-495b-9d54-d0d2e56fccd6","resolution":{"observed_at":"2026-08-15T20:45:55.307537Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2310.06387","last_updated":"2024-05-25T07:01:15Z","snapshot_observed_at":"2026-08-16T14:53:33.115609Z","submitted_at":"2023-10-10T07:50:29Z","title":"Jailbreak and Guard Aligned Language Models with Only Few In-Context Demonstrations","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2310.06387","snapshot_observed_at":"2026-08-15T20:45:55.311556Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.12060","last_updated":"2025-05-17T15:54:52Z","snapshot_observed_at":"2026-08-19T23:36:41.256008Z","submitted_at":"2025-05-17T15:54:52Z","title":"Why Not Act on What You Know? Unleashing Safety Potential of LLMs via Self-Aware Guard Enhancement","version":1},"reference_index":36,"source":"arxiv_source","source_observed_at":"2026-08-15T20:45:55.311556Z"},"links":{"cited_paper":"/paper/2310.06387","citing_paper":"/paper/2505.12060"},"observation_digest":"sha256:7834c879a1351384e7a6d69473d0895f6eeed22de2374b6a69616951394d08c7","observation_id":"f2908be1-0bdb-4385-8425-46098b195243","resolution":{"observed_at":"2026-08-15T20:45:55.311556Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T20:45:55.744783Z","title":null,"venue":null,"work_id":"b5cd87e8-e0c8-40fb-99cb-44947d371c90","year":2023},"citing_paper":{"arxiv_id":"2505.12060","last_updated":"2025-05-17T15:54:52Z","snapshot_observed_at":"2026-08-19T23:36:41.256008Z","submitted_at":"2025-05-17T15:54:52Z","title":"Why Not Act on What You Know? Unleashing Safety Potential of LLMs via Self-Aware Guard Enhancement","version":1},"reference_index":37,"source":"arxiv_source","source_observed_at":"2026-08-15T20:45:55.315835Z"},"links":{"citing_paper":"/paper/2505.12060"},"observation_digest":"sha256:2121a4f9b21499fe2a69c49ea88c553b497457a7da3deb411cc9c91ca3e142b6","observation_id":"95a3d297-22ff-4cde-b225-c4f24ce8a503","resolution":{"observed_at":"2026-08-15T20:45:55.748379Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T20:45:55.319351Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.12060","last_updated":"2025-05-17T15:54:52Z","snapshot_observed_at":"2026-08-19T23:36:41.256008Z","submitted_at":"2025-05-17T15:54:52Z","title":"Why Not Act on What You Know? Unleashing Safety Potential of LLMs via Self-Aware Guard Enhancement","version":1},"reference_index":38,"source":"arxiv_source","source_observed_at":"2026-08-15T20:45:55.319351Z"},"links":{"citing_paper":"/paper/2505.12060"},"observation_digest":"sha256:898e92452c50ef48921271e7bef16db3025832b0bc7131627805e9d589ff7c4e","observation_id":"c226f6fc-d887-4cdf-826e-39b600e10ddf","resolution":{"observed_at":"2026-08-15T20:45:55.319351Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2309.10253","last_updated":"2024-06-27T16:01:27Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2023-09-19T02:19:48Z","title":"GPTFUZZER: Red Teaming Large Language Models with Auto-Generated Jailbreak Prompts","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2309.10253","snapshot_observed_at":"2026-08-15T20:45:55.323905Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.12060","last_updated":"2025-05-17T15:54:52Z","snapshot_observed_at":"2026-08-19T23:36:41.256008Z","submitted_at":"2025-05-17T15:54:52Z","title":"Why Not Act on What You Know? Unleashing Safety Potential of LLMs via Self-Aware Guard Enhancement","version":1},"reference_index":39,"source":"arxiv_source","source_observed_at":"2026-08-15T20:45:55.323905Z"},"links":{"cited_paper":"/paper/2309.10253","citing_paper":"/paper/2505.12060"},"observation_digest":"sha256:471cba4cda3887765f5439cf93eaa702befcc9a4b1a9fe6037f7e41572cd3cd5","observation_id":"bffd855d-015d-46e8-9e16-cfe41e746466","resolution":{"observed_at":"2026-08-15T20:45:55.323905Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2401.06373","last_updated":"2024-01-23T22:46:12Z","snapshot_observed_at":"2026-08-20T15:39:34.196904Z","submitted_at":"2024-01-12T16:13:24Z","title":"How Johnny Can Persuade LLMs to Jailbreak Them: Rethinking Persuasion to Challenge AI Safety by Humanizing LLMs","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2401.06373","snapshot_observed_at":"2026-08-15T20:45:55.328199Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.12060","last_updated":"2025-05-17T15:54:52Z","snapshot_observed_at":"2026-08-19T23:36:41.256008Z","submitted_at":"2025-05-17T15:54:52Z","title":"Why Not Act on What You Know? Unleashing Safety Potential of LLMs via Self-Aware Guard Enhancement","version":1},"reference_index":40,"source":"arxiv_source","source_observed_at":"2026-08-15T20:45:55.328199Z"},"links":{"cited_paper":"/paper/2401.06373","citing_paper":"/paper/2505.12060"},"observation_digest":"sha256:24cf7856a8a2966b87ddfe7b09d7c94cc48b76e958d19f5602b4b79dcb38b644","observation_id":"83de0397-68ad-4fbd-b876-9211e302c92a","resolution":{"observed_at":"2026-08-15T20:45:55.328199Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T20:45:55.731829Z","title":null,"venue":null,"work_id":"f0619a66-e225-4e1a-9038-e7ef80641155","year":2024},"citing_paper":{"arxiv_id":"2505.12060","last_updated":"2025-05-17T15:54:52Z","snapshot_observed_at":"2026-08-19T23:36:41.256008Z","submitted_at":"2025-05-17T15:54:52Z","title":"Why Not Act on What You Know? Unleashing Safety Potential of LLMs via Self-Aware Guard Enhancement","version":1},"reference_index":41,"source":"arxiv_source","source_observed_at":"2026-08-15T20:45:55.332178Z"},"links":{"citing_paper":"/paper/2505.12060"},"observation_digest":"sha256:50d1e21df11f3958f0fd544616d6f33612f02c3f556a22fa545370a9d880cca8","observation_id":"8e7eaa9f-2b88-4bdc-afa5-949f2daba906","resolution":{"observed_at":"2026-08-15T20:45:55.736800Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T20:45:55.719524Z","title":null,"venue":null,"work_id":"ed3247c6-9ff0-41f5-a488-f33a08e9c2a3","year":2025},"citing_paper":{"arxiv_id":"2505.12060","last_updated":"2025-05-17T15:54:52Z","snapshot_observed_at":"2026-08-19T23:36:41.256008Z","submitted_at":"2025-05-17T15:54:52Z","title":"Why Not Act on What You Know? Unleashing Safety Potential of LLMs via Self-Aware Guard Enhancement","version":1},"reference_index":42,"source":"arxiv_source","source_observed_at":"2026-08-15T20:45:55.335939Z"},"links":{"citing_paper":"/paper/2505.12060"},"observation_digest":"sha256:b7342e452d1d33c9d0c62ef56e2b8280ace5bb0c29813d2efc2cba9870e1e0c3","observation_id":"410697ab-5fa0-4466-a3c3-715ecfe5905b","resolution":{"observed_at":"2026-08-15T20:45:55.723373Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2311.09096","last_updated":"2024-06-12T08:28:15Z","snapshot_observed_at":"2026-08-16T14:43:01.387615Z","submitted_at":"2023-11-15T16:42:29Z","title":"Defending Large Language Models Against Jailbreaking Attacks Through Goal Prioritization","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2311.09096","snapshot_observed_at":"2026-08-15T20:45:55.339667Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.12060","last_updated":"2025-05-17T15:54:52Z","snapshot_observed_at":"2026-08-19T23:36:41.256008Z","submitted_at":"2025-05-17T15:54:52Z","title":"Why Not Act on What You Know? Unleashing Safety Potential of LLMs via Self-Aware Guard Enhancement","version":1},"reference_index":43,"source":"arxiv_source","source_observed_at":"2026-08-15T20:45:55.339667Z"},"links":{"cited_paper":"/paper/2311.09096","citing_paper":"/paper/2505.12060"},"observation_digest":"sha256:66bb0a6bbd47d4c58ba4c98dca148b62786b61e68403e3b5e1a208a0de4ee0ed","observation_id":"c72befb0-ed0d-48e0-9948-e8042d70e250","resolution":{"observed_at":"2026-08-15T20:45:55.339667Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T20:45:55.707609Z","title":null,"venue":null,"work_id":"fffba1c7-8a9a-4753-adba-f1fdd16abbd8","year":2024},"citing_paper":{"arxiv_id":"2505.12060","last_updated":"2025-05-17T15:54:52Z","snapshot_observed_at":"2026-08-19T23:36:41.256008Z","submitted_at":"2025-05-17T15:54:52Z","title":"Why Not Act on What You Know? Unleashing Safety Potential of LLMs via Self-Aware Guard Enhancement","version":1},"reference_index":44,"source":"arxiv_source","source_observed_at":"2026-08-15T20:45:55.346828Z"},"links":{"citing_paper":"/paper/2505.12060"},"observation_digest":"sha256:01e46abeecf9b79215b6c435c39cd33aaa65fb301fcf752bf3fc5a9cc9e07b1e","observation_id":"e6c1b6c0-72f5-4802-b42b-09673dcd3c4a","resolution":{"observed_at":"2026-08-15T20:45:55.711455Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2406.05644","last_updated":"2024-06-13T05:39:31Z","snapshot_observed_at":"2026-08-20T09:36:09.271949Z","submitted_at":"2024-06-09T05:04:37Z","title":"How Alignment and Jailbreak Work: Explain LLM Safety through Intermediate Hidden States","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2406.05644","snapshot_observed_at":"2026-08-15T20:45:55.350773Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.12060","last_updated":"2025-05-17T15:54:52Z","snapshot_observed_at":"2026-08-19T23:36:41.256008Z","submitted_at":"2025-05-17T15:54:52Z","title":"Why Not Act on What You Know? Unleashing Safety Potential of LLMs via Self-Aware Guard Enhancement","version":1},"reference_index":45,"source":"arxiv_source","source_observed_at":"2026-08-15T20:45:55.350773Z"},"links":{"cited_paper":"/paper/2406.05644","citing_paper":"/paper/2505.12060"},"observation_digest":"sha256:db688604637dd1a373d6bfab100005026bdaf3ad938ffe6130bb481980910716","observation_id":"0b270832-d925-4afe-950e-90d540832e67","resolution":{"observed_at":"2026-08-15T20:45:55.350773Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T20:45:55.692624Z","title":null,"venue":null,"work_id":"c2930b90-2ebd-4dd6-9872-b672f401677d","year":2023},"citing_paper":{"arxiv_id":"2505.12060","last_updated":"2025-05-17T15:54:52Z","snapshot_observed_at":"2026-08-19T23:36:41.256008Z","submitted_at":"2025-05-17T15:54:52Z","title":"Why Not Act on What You Know? Unleashing Safety Potential of LLMs via Self-Aware Guard Enhancement","version":1},"reference_index":46,"source":"arxiv_source","source_observed_at":"2026-08-15T20:45:55.354560Z"},"links":{"citing_paper":"/paper/2505.12060"},"observation_digest":"sha256:dfc94989c207bf02733efd57e5e909a85cf90c7095c71b2762327c65b25aa265","observation_id":"8b4ea130-3938-4c43-89fc-9d0bc8f5936b","resolution":{"observed_at":"2026-08-15T20:45:55.697533Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-21T06:32:19.484+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2402.00858","last_updated":"2024-02-01T18:55:29Z","snapshot_observed_at":"2026-08-16T14:22:23.184245Z","submitted_at":"2024-02-01T18:55:29Z","title":"Can Large Language Models Understand Context?","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.00858","snapshot_observed_at":"2026-08-15T20:45:55.358524Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.12060","last_updated":"2025-05-17T15:54:52Z","snapshot_observed_at":"2026-08-19T23:36:41.256008Z","submitted_at":"2025-05-17T15:54:52Z","title":"Why Not Act on What You Know? Unleashing Safety Potential of LLMs via Self-Aware Guard Enhancement","version":1},"reference_index":47,"source":"arxiv_source","source_observed_at":"2026-08-15T20:45:55.358524Z"},"links":{"cited_paper":"/paper/2402.00858","citing_paper":"/paper/2505.12060"},"observation_digest":"sha256:dfd78a3f7c587543dc671219a54f5c4b5746d8cd56b374609d799df6ae054003","observation_id":"661e75be-95a1-4712-9f48-5c72250d2c3c","resolution":{"observed_at":"2026-08-15T20:45:55.358524Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2307.15043","last_updated":"2023-12-20T20:48:57Z","snapshot_observed_at":"2026-08-12T09:06:50.363435Z","submitted_at":"2023-07-27T17:49:12Z","title":"Universal and Transferable Adversarial Attacks on Aligned Language Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2307.15043","snapshot_observed_at":"2026-08-15T20:45:55.362359Z","title":"Zico Kolter, and Matt Fredrikson","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.12060","last_updated":"2025-05-17T15:54:52Z","snapshot_observed_at":"2026-08-19T23:36:41.256008Z","submitted_at":"2025-05-17T15:54:52Z","title":"Why Not Act on What You Know? Unleashing Safety Potential of LLMs via Self-Aware Guard Enhancement","version":1},"reference_index":48,"source":"arxiv_source","source_observed_at":"2026-08-15T20:45:55.362359Z"},"links":{"cited_paper":"/paper/2307.15043","citing_paper":"/paper/2505.12060"},"observation_digest":"sha256:a6ad21e9fa9c86a505f4d6ad948affd6f9b68b91549d1208428aa39c30774d03","observation_id":"7f86432d-de1c-4f80-95a9-30a9affc5135","resolution":{"observed_at":"2026-08-15T20:45:55.362359Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"paper":{"arxiv_id":"2505.12060","last_updated":"2025-05-17T15:54:52Z","latest_version":1,"primary_category":"cs.CL","snapshot_observed_at":"2026-08-19T23:36:41.256008Z","submitted_at":"2025-05-17T15:54:52Z","title":"Why Not Act on What You Know? Unleashing Safety Potential of LLMs via Self-Aware Guard Enhancement"},"reference_resolution":{"displayed":47,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":45,"verified_exact":0,"verified_fuzzy":2},"total_outbound_references":47},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"thesis":"As of 21 August 2026, this Paper Citation Record lists 47 of 47 outbound references and 0 inbound Pith citation observations for arXiv:2505.12060."}