{"as_of":"2026-08-16T23:29:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:d26915b525fcd0232b161161718f1491968ac67f9c47a5019c0060d2cc9f5e80","coverage":[{"denominator":36,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":36,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-16T12:19:43.290503Z","state":"measured"},{"denominator":36,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":36,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-16T06:30:59.297886+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2504.13052/citation-record","integrity":"/paper/2504.13052/integrity","json":"/paper/2504.13052/citation-record.json","paper":"/paper/2504.13052"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T12:19:43.143328Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2504.13052","last_updated":"2025-04-17T16:09:12Z","snapshot_observed_at":"2026-08-16T12:13:45.490791Z","submitted_at":"2025-04-17T16:09:12Z","title":"GraphAttack: Exploiting Representational Blindspots in LLM Safety Mechanisms","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-16T12:19:43.143328Z"},"links":{"citing_paper":"/paper/2504.13052"},"observation_digest":"sha256:fc7a9bc80d6b1116292dbe2b9ec9965a364882bf69565eac571968ca5d92e6b1","observation_id":"97ca7d1c-0d5e-4c38-b937-a3c5c8653d16","resolution":{"observed_at":"2026-08-16T12:19:43.143328Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2212.08073","last_updated":"2022-12-15T06:19:23Z","snapshot_observed_at":"2026-08-16T03:49:00.703994Z","submitted_at":"2022-12-15T06:19:23Z","title":"Constitutional AI: Harmlessness from AI Feedback","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2212.08073","snapshot_observed_at":"2026-08-16T12:19:43.148647Z","title":null,"venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2504.13052","last_updated":"2025-04-17T16:09:12Z","snapshot_observed_at":"2026-08-16T12:13:45.490791Z","submitted_at":"2025-04-17T16:09:12Z","title":"GraphAttack: Exploiting Representational Blindspots in LLM Safety Mechanisms","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-16T12:19:43.148647Z"},"links":{"cited_paper":"/paper/2212.08073","citing_paper":"/paper/2504.13052"},"observation_digest":"sha256:302518af07cafbfd8c7705f99eb1ffddd77c01ff94cd0b615bae5a11f66702e4","observation_id":"118e1112-7d1c-4038-9cf1-fce9188c2b53","resolution":{"observed_at":"2026-08-16T12:19:43.148647Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2204.05862","last_updated":"2022-04-12T15:02:38Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2022-04-12T15:02:38Z","title":"Training a Helpful and Harmless Assistant with Reinforcement Learning from Human Feedback","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2204.05862","snapshot_observed_at":"2026-08-16T12:19:43.153378Z","title":null,"venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2504.13052","last_updated":"2025-04-17T16:09:12Z","snapshot_observed_at":"2026-08-16T12:13:45.490791Z","submitted_at":"2025-04-17T16:09:12Z","title":"GraphAttack: Exploiting Representational Blindspots in LLM Safety Mechanisms","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-16T12:19:43.153378Z"},"links":{"cited_paper":"/paper/2204.05862","citing_paper":"/paper/2504.13052"},"observation_digest":"sha256:77ee58726b9df568b16ffc63090d08ff57fd4d5403e6c54d2e07de361fa819c6","observation_id":"811a994f-9aea-4927-95f7-ad8f026b6b9b","resolution":{"observed_at":"2026-08-16T12:19:43.153378Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T12:19:43.158269Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2504.13052","last_updated":"2025-04-17T16:09:12Z","snapshot_observed_at":"2026-08-16T12:13:45.490791Z","submitted_at":"2025-04-17T16:09:12Z","title":"GraphAttack: Exploiting Representational Blindspots in LLM Safety Mechanisms","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-16T12:19:43.158269Z"},"links":{"citing_paper":"/paper/2504.13052"},"observation_digest":"sha256:9f60eda640414e1fef2a648b98c533e9cf8448cd2d9c5fd48dda5a383b7b924e","observation_id":"32c7c8c7-4524-4028-a740-2539b93b3b0c","resolution":{"observed_at":"2026-08-16T12:19:43.158269Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T12:19:43.761856Z","title":null,"venue":null,"work_id":"e6374630-38db-4fae-887d-2b7dd2934d90","year":2021},"citing_paper":{"arxiv_id":"2504.13052","last_updated":"2025-04-17T16:09:12Z","snapshot_observed_at":"2026-08-16T12:13:45.490791Z","submitted_at":"2025-04-17T16:09:12Z","title":"GraphAttack: Exploiting Representational Blindspots in LLM Safety Mechanisms","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-16T12:19:43.167007Z"},"links":{"citing_paper":"/paper/2504.13052"},"observation_digest":"sha256:fb2de8c4e3b6aeea18b44bc9c961678e32b4aacbed73dfb439de410be5c2c72a","observation_id":"8d880b1e-11fa-4584-9f35-c8120ce55f4a","resolution":{"observed_at":"2026-08-16T12:19:43.765797Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T12:19:43.749361Z","title":"Brown, Benjamin Mann, Nick Ryder, Melanie Subbiah, Jared D","venue":null,"work_id":"2ee91c2f-c5e1-42e5-b391-e2ae76af3fd2","year":2020},"citing_paper":{"arxiv_id":"2504.13052","last_updated":"2025-04-17T16:09:12Z","snapshot_observed_at":"2026-08-16T12:13:45.490791Z","submitted_at":"2025-04-17T16:09:12Z","title":"GraphAttack: Exploiting Representational Blindspots in LLM Safety Mechanisms","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-16T12:19:43.171410Z"},"links":{"citing_paper":"/paper/2504.13052"},"observation_digest":"sha256:60d4059dd004e574c282b88772e126369b9cd37d85df12e877aa14a7b407615c","observation_id":"d3b2548c-b64d-47fb-ba9d-5a0edf2cdb43","resolution":{"observed_at":"2026-08-16T12:19:43.753505Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2310.08419","last_updated":"2024-07-18T18:24:57Z","snapshot_observed_at":"2026-08-16T13:08:51.920120Z","submitted_at":"2023-10-12T15:38:28Z","title":"Jailbreaking Black Box Large Language Models in Twenty Queries","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2310.08419","snapshot_observed_at":"2026-08-16T12:19:43.175652Z","title":"Pappas, and Eric Wong","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2504.13052","last_updated":"2025-04-17T16:09:12Z","snapshot_observed_at":"2026-08-16T12:13:45.490791Z","submitted_at":"2025-04-17T16:09:12Z","title":"GraphAttack: Exploiting Representational Blindspots in LLM Safety Mechanisms","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-16T12:19:43.175652Z"},"links":{"cited_paper":"/paper/2310.08419","citing_paper":"/paper/2504.13052"},"observation_digest":"sha256:fab0b13cfe5d8f3fcdb80c901477fc25d130def1dfd000d9e178709b03950dad","observation_id":"652e7996-236d-4768-a90b-9f7bc16bca9d","resolution":{"observed_at":"2026-08-16T12:19:43.175652Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2204.02311","last_updated":"2022-10-05T06:02:24Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2022-04-05T16:11:45Z","title":"PaLM: Scaling Language Modeling with Pathways","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2204.02311","snapshot_observed_at":"2026-08-16T12:19:43.181415Z","title":null,"venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2504.13052","last_updated":"2025-04-17T16:09:12Z","snapshot_observed_at":"2026-08-16T12:13:45.490791Z","submitted_at":"2025-04-17T16:09:12Z","title":"GraphAttack: Exploiting Representational Blindspots in LLM Safety Mechanisms","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-16T12:19:43.181415Z"},"links":{"cited_paper":"/paper/2204.02311","citing_paper":"/paper/2504.13052"},"observation_digest":"sha256:93c251faeb4a1313d4f201046cd0bcc5887be68738471a1a3c6b14218d130e8e","observation_id":"3d3a3249-ff8b-473c-a62f-25e760b3eceb","resolution":{"observed_at":"2026-08-16T12:19:43.181415Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T12:19:43.735735Z","title":"Christiano, Jan Leike, Tom Brown, Miljan Martic, Shane Legg, and Dario Amodei","venue":null,"work_id":"4a2bbef2-a6c0-4bb2-b170-eb474551de34","year":2017},"citing_paper":{"arxiv_id":"2504.13052","last_updated":"2025-04-17T16:09:12Z","snapshot_observed_at":"2026-08-16T12:13:45.490791Z","submitted_at":"2025-04-17T16:09:12Z","title":"GraphAttack: Exploiting Representational Blindspots in LLM Safety Mechanisms","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-16T12:19:43.185504Z"},"links":{"citing_paper":"/paper/2504.13052"},"observation_digest":"sha256:fafe1bdab60b35579b12a67518e97db11844143f785990ed18a142b15e71316d","observation_id":"1e87f891-c18e-4205-b13f-2a22924b6ac8","resolution":{"observed_at":"2026-08-16T12:19:43.741468Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T12:19:43.720568Z","title":null,"venue":null,"work_id":"3f8ef542-f6e0-43a4-bc55-1ba76e08b8a7","year":2017},"citing_paper":{"arxiv_id":"2504.13052","last_updated":"2025-04-17T16:09:12Z","snapshot_observed_at":"2026-08-16T12:13:45.490791Z","submitted_at":"2025-04-17T16:09:12Z","title":"GraphAttack: Exploiting Representational Blindspots in LLM Safety Mechanisms","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-16T12:19:43.189543Z"},"links":{"citing_paper":"/paper/2504.13052"},"observation_digest":"sha256:69b54745bd23080a203933812c0cc0f19b156b10f03f1ac700c86467d7f84ec6","observation_id":"d6015ac9-89f9-4acb-b4b5-84bc9fe685e2","resolution":{"observed_at":"2026-08-16T12:19:43.726013Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2203.14680","last_updated":"2022-10-12T18:01:23Z","snapshot_observed_at":"2026-08-16T17:11:19.673268Z","submitted_at":"2022-03-28T12:26:00Z","title":"Transformer Feed-Forward Layers Build Predictions by Promoting Concepts in the Vocabulary Space","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2203.14680","snapshot_observed_at":"2026-08-16T12:19:43.193692Z","title":null,"venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2504.13052","last_updated":"2025-04-17T16:09:12Z","snapshot_observed_at":"2026-08-16T12:13:45.490791Z","submitted_at":"2025-04-17T16:09:12Z","title":"GraphAttack: Exploiting Representational Blindspots in LLM Safety Mechanisms","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-16T12:19:43.193692Z"},"links":{"cited_paper":"/paper/2203.14680","citing_paper":"/paper/2504.13052"},"observation_digest":"sha256:85515d11085d47e2e1a411219edb3edc79e308dac1b8aed97e746d0b9a1379f9","observation_id":"d87ae1a4-a71d-4e46-a44c-4e4e780eddf4","resolution":{"observed_at":"2026-08-16T12:19:43.193692Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T12:19:43.707995Z","title":null,"venue":null,"work_id":"b4f2c7cd-6bb5-47b0-ac09-4770d9505399","year":2024},"citing_paper":{"arxiv_id":"2504.13052","last_updated":"2025-04-17T16:09:12Z","snapshot_observed_at":"2026-08-16T12:13:45.490791Z","submitted_at":"2025-04-17T16:09:12Z","title":"GraphAttack: Exploiting Representational Blindspots in LLM Safety Mechanisms","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-16T12:19:43.199848Z"},"links":{"citing_paper":"/paper/2504.13052"},"observation_digest":"sha256:0c8ae02ae075b1375edb0e1901ae9d941d7195687b21f118eb59134ac80f641e","observation_id":"9806ca26-e42d-4d14-9dea-65d88ec9637b","resolution":{"observed_at":"2026-08-16T12:19:43.711933Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T12:19:43.693364Z","title":null,"venue":null,"work_id":"725cc094-77a9-4809-993f-61b4e51f5c2e","year":2024},"citing_paper":{"arxiv_id":"2504.13052","last_updated":"2025-04-17T16:09:12Z","snapshot_observed_at":"2026-08-16T12:13:45.490791Z","submitted_at":"2025-04-17T16:09:12Z","title":"GraphAttack: Exploiting Representational Blindspots in LLM Safety Mechanisms","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-16T12:19:43.203863Z"},"links":{"citing_paper":"/paper/2504.13052"},"observation_digest":"sha256:9f1853d04c22096a985f1b73e1583fd4d9ebade1c150567e5f0b6694aaf1bcd3","observation_id":"266546f7-6626-4e6e-9e03-25fdf72376ca","resolution":{"observed_at":"2026-08-16T12:19:43.697932Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T12:19:43.677524Z","title":null,"venue":null,"work_id":"cded60c9-3535-44b9-bd7b-a349e8183e6a","year":2023},"citing_paper":{"arxiv_id":"2504.13052","last_updated":"2025-04-17T16:09:12Z","snapshot_observed_at":"2026-08-16T12:13:45.490791Z","submitted_at":"2025-04-17T16:09:12Z","title":"GraphAttack: Exploiting Representational Blindspots in LLM Safety Mechanisms","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-16T12:19:43.207779Z"},"links":{"citing_paper":"/paper/2504.13052"},"observation_digest":"sha256:c418bbce5897cbfe8882b1b40db45935d67d1f8bbe0e07f026c87a65b7a2eb84","observation_id":"d525fef6-adf0-4d78-b47e-90141a4fa4d7","resolution":{"observed_at":"2026-08-16T12:19:43.681676Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T12:19:43.664865Z","title":null,"venue":null,"work_id":"c7bbfeac-0994-4dc0-92b2-cf92f135484d","year":1989},"citing_paper":{"arxiv_id":"2504.13052","last_updated":"2025-04-17T16:09:12Z","snapshot_observed_at":"2026-08-16T12:13:45.490791Z","submitted_at":"2025-04-17T16:09:12Z","title":"GraphAttack: Exploiting Representational Blindspots in LLM Safety Mechanisms","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-16T12:19:43.211677Z"},"links":{"citing_paper":"/paper/2504.13052"},"observation_digest":"sha256:4def252a54b1cff8bee3c1ca992d624e9c20d1fa351ac11b547ed157ba618d53","observation_id":"b194a0e7-825a-42a4-bc14-3bccf7c95fbd","resolution":{"observed_at":"2026-08-16T12:19:43.668986Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T12:19:43.651745Z","title":null,"venue":null,"work_id":"e05a2f64-27ee-48cd-8ae1-a7c4d331ac14","year":null},"citing_paper":{"arxiv_id":"2504.13052","last_updated":"2025-04-17T16:09:12Z","snapshot_observed_at":"2026-08-16T12:13:45.490791Z","submitted_at":"2025-04-17T16:09:12Z","title":"GraphAttack: Exploiting Representational Blindspots in LLM Safety Mechanisms","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-16T12:19:43.215628Z"},"links":{"citing_paper":"/paper/2504.13052"},"observation_digest":"sha256:35f066c3d23979a3108e8fa1131f6987ad49de4ea9d3f7d51e92c0877fa281f4","observation_id":"cd4ef144-6e1c-4893-98e5-78c173712ea7","resolution":{"observed_at":"2026-08-16T12:19:43.656929Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2307.15852","last_updated":"2024-02-28T21:52:19Z","snapshot_observed_at":"2026-08-16T15:12:22.456889Z","submitted_at":"2023-07-29T00:51:26Z","title":"Dimensionless Policies based on the Buckingham $\\pi$ Theorem: Is This a Good Way to Generalize Numerical Results?","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2307.15852","snapshot_observed_at":"2026-08-16T12:19:43.219756Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2504.13052","last_updated":"2025-04-17T16:09:12Z","snapshot_observed_at":"2026-08-16T12:13:45.490791Z","submitted_at":"2025-04-17T16:09:12Z","title":"GraphAttack: Exploiting Representational Blindspots in LLM Safety Mechanisms","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-16T12:19:43.219756Z"},"links":{"cited_paper":"/paper/2307.15852","citing_paper":"/paper/2504.13052"},"observation_digest":"sha256:8909f34b090ffd903ab0c82fadcbc0e19a17ffb477c9e31868c95fc0cd354087","observation_id":"308f7068-d749-40fe-8af6-a0e05830fabc","resolution":{"observed_at":"2026-08-16T12:19:43.219756Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T12:19:43.223772Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2504.13052","last_updated":"2025-04-17T16:09:12Z","snapshot_observed_at":"2026-08-16T12:13:45.490791Z","submitted_at":"2025-04-17T16:09:12Z","title":"GraphAttack: Exploiting Representational Blindspots in LLM Safety Mechanisms","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-16T12:19:43.223772Z"},"links":{"citing_paper":"/paper/2504.13052"},"observation_digest":"sha256:0ccfcba51427b9c5288138e019f347aaaa583b9fee4610cd8e1e4113f4234035","observation_id":"7e39b708-40ce-4aa9-96c4-7f7bbfb56129","resolution":{"observed_at":"2026-08-16T12:19:43.223772Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2312.02119","last_updated":"2024-10-31T15:57:42Z","snapshot_observed_at":"2026-08-16T14:37:45.469470Z","submitted_at":"2023-12-04T18:49:23Z","title":"Tree of Attacks: Jailbreaking Black-Box LLMs Automatically","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2312.02119","snapshot_observed_at":"2026-08-16T12:19:43.227849Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2504.13052","last_updated":"2025-04-17T16:09:12Z","snapshot_observed_at":"2026-08-16T12:13:45.490791Z","submitted_at":"2025-04-17T16:09:12Z","title":"GraphAttack: Exploiting Representational Blindspots in LLM Safety Mechanisms","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-16T12:19:43.227849Z"},"links":{"cited_paper":"/paper/2312.02119","citing_paper":"/paper/2504.13052"},"observation_digest":"sha256:4c78620a8401dcb0ff017cbc507ebac5eacbf7815c56c10d5e258b0329acff24","observation_id":"6cb12c34-8145-4982-9f69-91fa706c6313","resolution":{"observed_at":"2026-08-16T12:19:43.227849Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T12:19:43.630215Z","title":null,"venue":null,"work_id":"d9ea3cb5-d20f-484d-8989-3a1e86cc208e","year":2024},"citing_paper":{"arxiv_id":"2504.13052","last_updated":"2025-04-17T16:09:12Z","snapshot_observed_at":"2026-08-16T12:13:45.490791Z","submitted_at":"2025-04-17T16:09:12Z","title":"GraphAttack: Exploiting Representational Blindspots in LLM Safety Mechanisms","version":1},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-16T12:19:43.232538Z"},"links":{"citing_paper":"/paper/2504.13052"},"observation_digest":"sha256:e6fa01e6e91878ed2b5912d677989318f7a5cba399b782f04bba99cbb14340ee","observation_id":"dee33961-7857-401f-bb49-9a725cc6d57a","resolution":{"observed_at":"2026-08-16T12:19:43.635163Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T12:19:43.617338Z","title":null,"venue":null,"work_id":"54e7d587-46c8-47e2-97b1-6ebe39df24dd","year":1998},"citing_paper":{"arxiv_id":"2504.13052","last_updated":"2025-04-17T16:09:12Z","snapshot_observed_at":"2026-08-16T12:13:45.490791Z","submitted_at":"2025-04-17T16:09:12Z","title":"GraphAttack: Exploiting Representational Blindspots in LLM Safety Mechanisms","version":1},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-16T12:19:43.236323Z"},"links":{"citing_paper":"/paper/2504.13052"},"observation_digest":"sha256:f229954a14f63771a6cd7e28c65ab443e40ec84727e974086fb643ad9c0a7d5c","observation_id":"7bcdf1c7-5f21-4f98-80ae-771f9ac3ef26","resolution":{"observed_at":"2026-08-16T12:19:43.621779Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T12:19:43.240112Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2504.13052","last_updated":"2025-04-17T16:09:12Z","snapshot_observed_at":"2026-08-16T12:13:45.490791Z","submitted_at":"2025-04-17T16:09:12Z","title":"GraphAttack: Exploiting Representational Blindspots in LLM Safety Mechanisms","version":1},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-16T12:19:43.240112Z"},"links":{"citing_paper":"/paper/2504.13052"},"observation_digest":"sha256:9d853ad605341e84e362f48d86f7631306e54d58a69daffbc6179565e35dcaa0","observation_id":"ac4a5a95-5af9-498c-a05e-83a84d76d493","resolution":{"observed_at":"2026-08-16T12:19:43.240112Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2203.02155","last_updated":"2022-03-04T07:04:42Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2022-03-04T07:04:42Z","title":"Training language models to follow instructions with human feedback","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2203.02155","snapshot_observed_at":"2026-08-16T12:19:43.243830Z","title":"Wainwright, Pamela Mishkin, Chong Zhang, Sandhini Agarwal, Katarina Slama, Alex Ray, et al","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2504.13052","last_updated":"2025-04-17T16:09:12Z","snapshot_observed_at":"2026-08-16T12:13:45.490791Z","submitted_at":"2025-04-17T16:09:12Z","title":"GraphAttack: Exploiting Representational Blindspots in LLM Safety Mechanisms","version":1},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-16T12:19:43.243830Z"},"links":{"cited_paper":"/paper/2203.02155","citing_paper":"/paper/2504.13052"},"observation_digest":"sha256:567dd5cd78980d430fe3c19dc118c3a48aeb093ce73569e5ebc7fd17bd1f0c3f","observation_id":"a0ec0796-942a-4426-9333-925076d2bd28","resolution":{"observed_at":"2026-08-16T12:19:43.243830Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2202.03286","last_updated":"2022-02-07T15:22:17Z","snapshot_observed_at":"2026-08-15T19:46:54.909325Z","submitted_at":"2022-02-07T15:22:17Z","title":"Red Teaming Language Models with Language Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2202.03286","snapshot_observed_at":"2026-08-16T12:19:43.247800Z","title":"Riedl, Nisan Stiennon, Nathan Scales, Aimee Chan, Mark van der Wilk, et al","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2504.13052","last_updated":"2025-04-17T16:09:12Z","snapshot_observed_at":"2026-08-16T12:13:45.490791Z","submitted_at":"2025-04-17T16:09:12Z","title":"GraphAttack: Exploiting Representational Blindspots in LLM Safety Mechanisms","version":1},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-16T12:19:43.247800Z"},"links":{"cited_paper":"/paper/2202.03286","citing_paper":"/paper/2504.13052"},"observation_digest":"sha256:6632352b089ced2019ccab393d11e101ab388c1d5cddba1525dff5147576cc1b","observation_id":"1e1b977f-11de-42e1-ad99-21424737cd7a","resolution":{"observed_at":"2026-08-16T12:19:43.247800Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2310.03693","last_updated":"2023-10-05T17:12:17Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2023-10-05T17:12:17Z","title":"Fine-tuning Aligned Language Models Compromises Safety, Even When Users Do Not Intend To!","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2310.03693","snapshot_observed_at":"2026-08-16T12:19:43.251671Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2504.13052","last_updated":"2025-04-17T16:09:12Z","snapshot_observed_at":"2026-08-16T12:13:45.490791Z","submitted_at":"2025-04-17T16:09:12Z","title":"GraphAttack: Exploiting Representational Blindspots in LLM Safety Mechanisms","version":1},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-08-16T12:19:43.251671Z"},"links":{"cited_paper":"/paper/2310.03693","citing_paper":"/paper/2504.13052"},"observation_digest":"sha256:3c688b8ff995f2e8f0ff2139309aa12d6167d89ee45f99f6463cc9b03aa07c7e","observation_id":"92bad072-0b99-4894-a0fc-03834dc80dde","resolution":{"observed_at":"2026-08-16T12:19:43.251671Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2406.09321","last_updated":"2025-02-04T16:04:22Z","snapshot_observed_at":"2026-08-16T13:43:15.198180Z","submitted_at":"2024-06-13T16:59:43Z","title":"JailbreakEval: An Integrated Toolkit for Evaluating Jailbreak Attempts Against Large Language Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2406.09321","snapshot_observed_at":"2026-08-16T12:19:43.255707Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2504.13052","last_updated":"2025-04-17T16:09:12Z","snapshot_observed_at":"2026-08-16T12:13:45.490791Z","submitted_at":"2025-04-17T16:09:12Z","title":"GraphAttack: Exploiting Representational Blindspots in LLM Safety Mechanisms","version":1},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-08-16T12:19:43.255707Z"},"links":{"cited_paper":"/paper/2406.09321","citing_paper":"/paper/2504.13052"},"observation_digest":"sha256:932c83236693c19fd3549b7943b835ac2cb962ebd2bd03d181cdca457bc7fcff","observation_id":"4a6c8530-3350-42f1-9823-34a7cd62de4b","resolution":{"observed_at":"2026-08-16T12:19:43.255707Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T12:19:43.597379Z","title":null,"venue":null,"work_id":"19b94680-a9ad-457f-b118-c3b5838156e1","year":2024},"citing_paper":{"arxiv_id":"2504.13052","last_updated":"2025-04-17T16:09:12Z","snapshot_observed_at":"2026-08-16T12:13:45.490791Z","submitted_at":"2025-04-17T16:09:12Z","title":"GraphAttack: Exploiting Representational Blindspots in LLM Safety Mechanisms","version":1},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-08-16T12:19:43.259769Z"},"links":{"citing_paper":"/paper/2504.13052"},"observation_digest":"sha256:e5c117fa1621d2baa658ca7d607e1abe113f5c8e4c1460951b0197aabc331d5f","observation_id":"3375a036-5715-4335-8b84-4de6ba3d4ec9","resolution":{"observed_at":"2026-08-16T12:19:43.601506Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T12:19:43.583777Z","title":null,"venue":null,"work_id":"c7b2225a-9831-423a-8c69-f285a6111959","year":null},"citing_paper":{"arxiv_id":"2504.13052","last_updated":"2025-04-17T16:09:12Z","snapshot_observed_at":"2026-08-16T12:13:45.490791Z","submitted_at":"2025-04-17T16:09:12Z","title":"GraphAttack: Exploiting Representational Blindspots in LLM Safety Mechanisms","version":1},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-08-16T12:19:43.263894Z"},"links":{"citing_paper":"/paper/2504.13052"},"observation_digest":"sha256:94bf505b5af0e13b3104556a2811ed3d4e1bf1db53b6b9ea2a544c34015c5fd6","observation_id":"604df649-8fcc-46de-9a5e-abf9a300014c","resolution":{"observed_at":"2026-08-16T12:19:43.588791Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T12:19:43.570441Z","title":null,"venue":null,"work_id":"f96a0b70-716e-4adb-8ed4-4bd271c6ee7b","year":2025},"citing_paper":{"arxiv_id":"2504.13052","last_updated":"2025-04-17T16:09:12Z","snapshot_observed_at":"2026-08-16T12:13:45.490791Z","submitted_at":"2025-04-17T16:09:12Z","title":"GraphAttack: Exploiting Representational Blindspots in LLM Safety Mechanisms","version":1},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-08-16T12:19:43.271630Z"},"links":{"citing_paper":"/paper/2504.13052"},"observation_digest":"sha256:e73ab29686409951a89e3ef384dab647368bf04b524954406484ec4d83726166","observation_id":"2672420b-f5dc-4646-9501-7e3f02d6788e","resolution":{"observed_at":"2026-08-16T12:19:43.574871Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T12:19:43.556152Z","title":null,"venue":null,"work_id":"261c516a-e3dd-43a2-9342-9bd6cc33cfdc","year":2019},"citing_paper":{"arxiv_id":"2504.13052","last_updated":"2025-04-17T16:09:12Z","snapshot_observed_at":"2026-08-16T12:13:45.490791Z","submitted_at":"2025-04-17T16:09:12Z","title":"GraphAttack: Exploiting Representational Blindspots in LLM Safety Mechanisms","version":1},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-08-16T12:19:43.275223Z"},"links":{"citing_paper":"/paper/2504.13052"},"observation_digest":"sha256:dc9ab059a884bb1b4d1b9801e385757ce074fa36d683189bb57693868d315aa3","observation_id":"ad23a658-881c-4669-861b-e69216d9075b","resolution":{"observed_at":"2026-08-16T12:19:43.561752Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2307.02483","last_updated":"2023-07-05T17:58:10Z","snapshot_observed_at":"2026-08-15T10:16:52.688429Z","submitted_at":"2023-07-05T17:58:10Z","title":"Jailbroken: How Does LLM Safety Training Fail?","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2307.02483","snapshot_observed_at":"2026-08-16T12:19:43.278713Z","title":"Chi, Quoc V","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2504.13052","last_updated":"2025-04-17T16:09:12Z","snapshot_observed_at":"2026-08-16T12:13:45.490791Z","submitted_at":"2025-04-17T16:09:12Z","title":"GraphAttack: Exploiting Representational Blindspots in LLM Safety Mechanisms","version":1},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-08-16T12:19:43.278713Z"},"links":{"cited_paper":"/paper/2307.02483","citing_paper":"/paper/2504.13052"},"observation_digest":"sha256:98ad557e72ae37507b63230b958de4571a9cd2bc1940acd30a38a7e99156740a","observation_id":"350f2fc8-3cbd-4df7-9d0c-666506826f6b","resolution":{"observed_at":"2026-08-16T12:19:43.278713Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T12:19:43.282682Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2504.13052","last_updated":"2025-04-17T16:09:12Z","snapshot_observed_at":"2026-08-16T12:13:45.490791Z","submitted_at":"2025-04-17T16:09:12Z","title":"GraphAttack: Exploiting Representational Blindspots in LLM Safety Mechanisms","version":1},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-08-16T12:19:43.282682Z"},"links":{"citing_paper":"/paper/2504.13052"},"observation_digest":"sha256:06f9ce9fce4a84574af46033cf2fcd6ac905bd4848c40137e58c56d01fb3fef9","observation_id":"7f9c0d9b-d5ca-4b42-a2cb-82e98b14aead","resolution":{"observed_at":"2026-08-16T12:19:43.282682Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2401.06561","last_updated":"2024-12-16T08:43:24Z","snapshot_observed_at":"2026-08-16T14:27:57.381603Z","submitted_at":"2024-01-12T13:15:05Z","title":"Intention Analysis Makes LLMs A Good Jailbreak Defender","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2401.06561","snapshot_observed_at":"2026-08-16T12:19:43.286453Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2504.13052","last_updated":"2025-04-17T16:09:12Z","snapshot_observed_at":"2026-08-16T12:13:45.490791Z","submitted_at":"2025-04-17T16:09:12Z","title":"GraphAttack: Exploiting Representational Blindspots in LLM Safety Mechanisms","version":1},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-08-16T12:19:43.286453Z"},"links":{"cited_paper":"/paper/2401.06561","citing_paper":"/paper/2504.13052"},"observation_digest":"sha256:d00aa7d198ec1f50e58cd66ff1b4511ecbd1e00bf40b7faf5a47ec0b47d66c39","observation_id":"b45a4906-2582-42b8-955e-5885222aea9a","resolution":{"observed_at":"2026-08-16T12:19:43.286453Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"2307.15027","doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T12:19:43.374870Z","title":null,"venue":null,"work_id":"c77896be-88cb-43c3-8f97-a17051978951","year":2023},"citing_paper":{"arxiv_id":"2504.13052","last_updated":"2025-04-17T16:09:12Z","snapshot_observed_at":"2026-08-16T12:13:45.490791Z","submitted_at":"2025-04-17T16:09:12Z","title":"GraphAttack: Exploiting Representational Blindspots in LLM Safety Mechanisms","version":1},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-08-16T12:19:43.290503Z"},"links":{"citing_paper":"/paper/2504.13052"},"observation_digest":"sha256:30cc2cb32113531dcede1d726ac65f699b5eba6972489ca9eb0ab0f02ec17c6f","observation_id":"e7cae675-c0a7-422b-902b-ceca414e8fef","resolution":{"observed_at":"2026-08-16T12:19:43.381976Z","resolver_source":"raw_fallback","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T12:19:43.162770Z","title":"In Proceedings of the 7th linguistic annotation workshop and interoperability with discourse","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2504.13052","last_updated":"2025-04-17T16:09:12Z","snapshot_observed_at":"2026-08-16T12:13:45.490791Z","submitted_at":"2025-04-17T16:09:12Z","title":"GraphAttack: Exploiting Representational Blindspots in LLM Safety Mechanisms","version":1},"reference_index":2013,"source":"pdf_text","source_observed_at":"2026-08-16T12:19:43.162770Z"},"links":{"citing_paper":"/paper/2504.13052"},"observation_digest":"sha256:bbf0406608ee1af9f5722415600f3f83f9ecf74c71adf5bc6288be6882215045","observation_id":"60888ade-9167-4b87-9409-905624aa94f1","resolution":{"observed_at":"2026-08-16T12:19:43.162770Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2307.15043","last_updated":"2023-12-20T20:48:57Z","snapshot_observed_at":"2026-08-12T09:06:50.363435Z","submitted_at":"2023-07-27T17:49:12Z","title":"Universal and Transferable Adversarial Attacks on Aligned Language Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2307.15043","snapshot_observed_at":"2026-08-16T12:19:43.267743Z","title":"arXiv preprint arXiv:2307.15043 (2023)","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2504.13052","last_updated":"2025-04-17T16:09:12Z","snapshot_observed_at":"2026-08-16T12:13:45.490791Z","submitted_at":"2025-04-17T16:09:12Z","title":"GraphAttack: Exploiting Representational Blindspots in LLM Safety Mechanisms","version":1},"reference_index":2023,"source":"pdf_text","source_observed_at":"2026-08-16T12:19:43.267743Z"},"links":{"cited_paper":"/paper/2307.15043","citing_paper":"/paper/2504.13052"},"observation_digest":"sha256:8ed246be3b4478c480c3db0949612c92cbd641111b9d2bff5a59ef0a3da08c1e","observation_id":"b139c57a-92d3-4950-82f9-dcb1782ef004","resolution":{"observed_at":"2026-08-16T12:19:43.267743Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"paper":{"arxiv_id":"2504.13052","last_updated":"2025-04-17T16:09:12Z","latest_version":1,"primary_category":"cs.CR","snapshot_observed_at":"2026-08-16T12:13:45.490791Z","submitted_at":"2025-04-17T16:09:12Z","title":"GraphAttack: Exploiting Representational Blindspots in LLM Safety Mechanisms"},"reference_resolution":{"displayed":36,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":33,"verified_exact":1,"verified_fuzzy":2},"total_outbound_references":36},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"thesis":"As of 16 August 2026, this Paper Citation Record lists 36 of 36 outbound references and 0 inbound Pith citation observations for arXiv:2504.13052."}