{"as_of":"2026-08-15T04:17:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:5f7e37fc483d132d96f1e3f71f8a8cf6c58bbfdf873717721fe809330b8d1473","coverage":[{"denominator":44,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":44,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-07T12:01:11.473485Z","state":"measured"},{"denominator":52,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":52,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-14T06:32:32.682623+00:00","state":"measured"},{"denominator":8,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":8,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-01T16:21:26.984437Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"arxiv_reference","source_observed_at":"2026-07-02T04:16:34.709256Z","state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2506.00782","last_updated":"2025-06-01T02:19:46Z","snapshot_observed_at":"2026-08-07T11:55:45.889580Z","submitted_at":"2025-06-01T02:19:46Z","title":"Jailbreak-R1: Exploring the Jailbreak Capabilities of LLMs via Reinforcement Learning","version":1},"cited_work":{"arxiv_id":"2506.00782","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2506.00782","snapshot_observed_at":"2026-07-02T04:16:34.709256Z","title":"Jailbreak-r1: Exploring the jailbreak capabilities of llms via reinforcement learning.CoRR, abs/2506.00782","venue":null,"work_id":"e1b826c4-b88f-470c-9a0b-efe2984efb7e","year":2025},"citing_paper":{"arxiv_id":"2605.00553","last_updated":"2026-06-30T04:24:39Z","snapshot_observed_at":"2026-08-14T17:20:40.469456Z","submitted_at":"2026-05-01T10:42:08Z","title":"Stable-GFlowNet: Toward Diverse and Robust LLM Red-Teaming via Contrastive Trajectory Balance","version":1},"reference_index":5,"source":"arxiv_source","source_observed_at":"2026-05-09T19:29:36.348680Z"},"links":{"cited_paper":"/paper/2506.00782","citing_paper":"/paper/2605.00553"},"observation_digest":"sha256:f37b0f88fd07f1d2dd86b4ba897f44ceb5112b2fd49bb678020e65edb27b8fca","observation_id":"3caa8e0b-18b1-4a1e-a875-266a80aa3761","resolution":{"observed_at":"2026-05-11T15:41:16.865385Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2506.00782","last_updated":"2025-06-01T02:19:46Z","snapshot_observed_at":"2026-08-07T11:55:45.889580Z","submitted_at":"2025-06-01T02:19:46Z","title":"Jailbreak-R1: Exploring the Jailbreak Capabilities of LLMs via Reinforcement Learning","version":1},"cited_work":{"arxiv_id":"2506.00782","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2506.00782","snapshot_observed_at":"2026-07-02T04:16:34.709256Z","title":"Jailbreak-r1: Exploring the jailbreak capabilities of llms via reinforcement learning.CoRR, abs/2506.00782","venue":null,"work_id":"e1b826c4-b88f-470c-9a0b-efe2984efb7e","year":2025},"citing_paper":{"arxiv_id":"2605.08930","last_updated":"2026-05-09T13:05:00Z","snapshot_observed_at":"2026-08-11T17:20:44.184841Z","submitted_at":"2026-05-09T13:05:00Z","title":"Internalizing Safety Understanding in Large Reasoning Models via Verification","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-05-12T01:50:59.283409Z"},"links":{"cited_paper":"/paper/2506.00782","citing_paper":"/paper/2605.08930"},"observation_digest":"sha256:6d11d9545629e46e7153cbe404d28c99bfc65265fc5e809756bcef2e28cf0102","observation_id":"4426f7f5-4c93-4191-8186-f553eb93f59c","resolution":{"observed_at":"2026-05-12T01:51:14.269926Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2506.00782","last_updated":"2025-06-01T02:19:46Z","snapshot_observed_at":"2026-08-07T11:55:45.889580Z","submitted_at":"2025-06-01T02:19:46Z","title":"Jailbreak-R1: Exploring the Jailbreak Capabilities of LLMs via Reinforcement Learning","version":1},"cited_work":{"arxiv_id":"2506.00782","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2506.00782","snapshot_observed_at":"2026-07-02T04:16:34.709256Z","title":"Jailbreak-r1: Exploring the jailbreak capabilities of llms via reinforcement learning.CoRR, abs/2506.00782","venue":null,"work_id":"e1b826c4-b88f-470c-9a0b-efe2984efb7e","year":2025},"citing_paper":{"arxiv_id":"2605.08936","last_updated":"2026-05-09T13:14:31Z","snapshot_observed_at":"2026-08-11T05:52:24.157557Z","submitted_at":"2026-05-09T13:14:31Z","title":"Self-ReSET: Learning to Self-Recover from Unsafe Reasoning Trajectories","version":1},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-05-12T02:07:04.364417Z"},"links":{"cited_paper":"/paper/2506.00782","citing_paper":"/paper/2605.08936"},"observation_digest":"sha256:a191f0e14ebed391379fab84daf577d8f1a9b8895bc5066ef228e2dd264da891","observation_id":"4645865c-d491-420f-917f-eb479a6b126e","resolution":{"observed_at":"2026-05-12T02:11:16.194279Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2506.00782","last_updated":"2025-06-01T02:19:46Z","snapshot_observed_at":"2026-08-07T11:55:45.889580Z","submitted_at":"2025-06-01T02:19:46Z","title":"Jailbreak-R1: Exploring the Jailbreak Capabilities of LLMs via Reinforcement Learning","version":1},"cited_work":{"arxiv_id":"2506.00782","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2506.00782","snapshot_observed_at":"2026-07-02T04:16:34.709256Z","title":"Jailbreak-r1: Exploring the jailbreak capabilities of llms via reinforcement learning.CoRR, abs/2506.00782","venue":null,"work_id":"e1b826c4-b88f-470c-9a0b-efe2984efb7e","year":2025},"citing_paper":{"arxiv_id":"2606.03647","last_updated":"2026-06-02T13:39:15Z","snapshot_observed_at":"2026-07-06T23:43:50.943530Z","submitted_at":"2026-06-02T13:39:15Z","title":"Black-box, Adaptive, Efficient, Transferable, Harmful, Applicable... Attacks Are All You Need to Break LLMs","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-06-28T09:21:57.373862Z"},"links":{"cited_paper":"/paper/2506.00782","citing_paper":"/paper/2606.03647"},"observation_digest":"sha256:ddc8fd45f724483f24453a4d784ed248eb3d8e216abd8f336d5626aab929ec70","observation_id":"a31831b8-9265-4c4e-9e19-3609eaaf51d2","resolution":{"observed_at":"2026-07-02T04:16:34.711696Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2506.00782","last_updated":"2025-06-01T02:19:46Z","snapshot_observed_at":"2026-08-07T11:55:45.889580Z","submitted_at":"2025-06-01T02:19:46Z","title":"Jailbreak-R1: Exploring the Jailbreak Capabilities of LLMs via Reinforcement Learning","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2506.00782","snapshot_observed_at":"2026-07-11T22:40:37.839133Z","title":"Jailbreak-r1: Exploring the jailbreak capabilities of llms via reinforcement learning,","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.03968","last_updated":"2026-07-09T20:41:05Z","snapshot_observed_at":"2026-08-13T02:35:48.611379Z","submitted_at":"2026-07-04T17:57:05Z","title":"Refused in Chat, Written in Code: Workflow-Level Jailbreak Construction in IDE Coding Agents","version":1},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-07-11T22:40:37.839133Z"},"links":{"cited_paper":"/paper/2506.00782","citing_paper":"/paper/2607.03968"},"observation_digest":"sha256:d9e24ab935b697dcf6f154129e4c2bd3c3a509a154b9758e196a7cf2c22aa943","observation_id":"e777a612-105b-4bf5-bd5a-b1cd2db8b8f5","resolution":{"observed_at":"2026-07-11T22:40:37.839133Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2506.00782","last_updated":"2025-06-01T02:19:46Z","snapshot_observed_at":"2026-08-07T11:55:45.889580Z","submitted_at":"2025-06-01T02:19:46Z","title":"Jailbreak-R1: Exploring the Jailbreak Capabilities of LLMs via Reinforcement Learning","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2506.00782","snapshot_observed_at":"2026-07-13T07:01:49.222325Z","title":"Jailbreak-r1: Exploring the jailbreak capabilities of llms via reinforcement learning,","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.03968","last_updated":"2026-07-09T20:41:05Z","snapshot_observed_at":"2026-08-13T02:35:48.611379Z","submitted_at":"2026-07-04T17:57:05Z","title":"Refused in Chat, Written in Code: Workflow-Level Jailbreak Construction in IDE Coding Agents","version":2},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-07-13T07:01:49.222325Z"},"links":{"cited_paper":"/paper/2506.00782","citing_paper":"/paper/2607.03968"},"observation_digest":"sha256:e4247840ed873f83c3ae8f8ae069bf100a4b2931e439375afe9671a4e585b6de","observation_id":"0b78426c-7ced-42f2-b964-4f713e454373","resolution":{"observed_at":"2026-07-13T07:01:49.222325Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2506.00782","last_updated":"2025-06-01T02:19:46Z","snapshot_observed_at":"2026-08-07T11:55:45.889580Z","submitted_at":"2025-06-01T02:19:46Z","title":"Jailbreak-R1: Exploring the Jailbreak Capabilities of LLMs via Reinforcement Learning","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2506.00782","snapshot_observed_at":"2026-07-14T07:16:57.009797Z","title":"Jailbreak-r1: Exploring the jailbreak capabilities of llms via reinforcement learning.arXiv preprint arXiv:2506.00782, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.11070","last_updated":"2026-07-13T04:19:37Z","snapshot_observed_at":"2026-08-15T03:29:01.595863Z","submitted_at":"2026-07-13T04:19:37Z","title":"MJ: Multi-turn LLM Jailbreaking via Decomposed Credit Assignment","version":1},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-07-14T07:16:57.009797Z"},"links":{"cited_paper":"/paper/2506.00782","citing_paper":"/paper/2607.11070"},"observation_digest":"sha256:8b1ac2ea87738aca614204a57fb74e9b8c74c9e94aa941387132c31f09a694b9","observation_id":"f8ab7de0-ef03-447a-9f60-7378374f6c54","resolution":{"observed_at":"2026-07-14T07:16:57.009797Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2506.00782","last_updated":"2025-06-01T02:19:46Z","snapshot_observed_at":"2026-08-07T11:55:45.889580Z","submitted_at":"2025-06-01T02:19:46Z","title":"Jailbreak-R1: Exploring the Jailbreak Capabilities of LLMs via Reinforcement Learning","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2506.00782","snapshot_observed_at":"2026-08-01T16:21:26.984437Z","title":"Jailbreak-R1: Exploring the Jailbreak Capabilities of LLMs via Reinforcement Learning","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.18056","last_updated":"2026-08-06T06:39:11Z","snapshot_observed_at":"2026-08-14T23:34:32.434676Z","submitted_at":"2026-07-20T15:26:23Z","title":"An Early Warning of Emerging Biosecurity Risks in Frontier LLMs","version":1},"reference_index":50,"source":"pdf_text","source_observed_at":"2026-08-01T16:21:26.984437Z"},"links":{"cited_paper":"/paper/2506.00782","citing_paper":"/paper/2607.18056"},"observation_digest":"sha256:f887b57b21420bd8aab8d40442993505b39d477a378be38a1709773c73aa27b2","observation_id":"6b3f8d1d-b25c-4b2c-a058-d53d4c66aeff","resolution":{"observed_at":"2026-08-01T16:21:26.984437Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"links":{"evidence":"/evidence","html":"/paper/2506.00782/citation-record","integrity":"/paper/2506.00782/integrity","json":"/paper/2506.00782/citation-record.json","paper":"/paper/2506.00782"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:01:15.845946Z","title":"Claude-3.5-sonnet, 2024","venue":null,"work_id":"b1d13a56-b334-4c92-b3c2-21407b4b91dd","year":2024},"citing_paper":{"arxiv_id":"2506.00782","last_updated":"2025-06-01T02:19:46Z","snapshot_observed_at":"2026-08-07T11:55:45.889580Z","submitted_at":"2025-06-01T02:19:46Z","title":"Jailbreak-R1: Exploring the Jailbreak Capabilities of LLMs via Reinforcement Learning","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-07T12:01:08.174595Z"},"links":{"citing_paper":"/paper/2506.00782"},"observation_digest":"sha256:31a0d25d5c0d68528cdafdbe12e7dfce514fd2f8e952059b7c35a78d415d52c8","observation_id":"9a1e72f4-36bd-4f13-ba4c-6fb71b2c8699","resolution":{"observed_at":"2026-08-07T12:01:15.888902Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2412.18693","last_updated":"2024-12-24T22:38:46Z","snapshot_observed_at":"2026-08-12T00:45:04.339287Z","submitted_at":"2024-12-24T22:38:46Z","title":"Diverse and Effective Red Teaming with Auto-generated Rewards and Multi-step Reinforcement Learning","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2412.18693","snapshot_observed_at":"2026-08-07T12:01:08.215841Z","title":"Beutel, K","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.00782","last_updated":"2025-06-01T02:19:46Z","snapshot_observed_at":"2026-08-07T11:55:45.889580Z","submitted_at":"2025-06-01T02:19:46Z","title":"Jailbreak-R1: Exploring the Jailbreak Capabilities of LLMs via Reinforcement Learning","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-07T12:01:08.215841Z"},"links":{"cited_paper":"/paper/2412.18693","citing_paper":"/paper/2506.00782"},"observation_digest":"sha256:2bf6f91942f6285414b06762895d1ede2e5be8e9d38bc72b4df366fdcecebb65","observation_id":"a57cad7f-0a66-442d-ba67-07d698debdec","resolution":{"observed_at":"2026-08-07T12:01:08.215841Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:01:15.738424Z","title":"Bhardwaj, D","venue":null,"work_id":"ec67667d-1de1-4e82-8870-cdbcb06a12fa","year":2024},"citing_paper":{"arxiv_id":"2506.00782","last_updated":"2025-06-01T02:19:46Z","snapshot_observed_at":"2026-08-07T11:55:45.889580Z","submitted_at":"2025-06-01T02:19:46Z","title":"Jailbreak-R1: Exploring the Jailbreak Capabilities of LLMs via Reinforcement Learning","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-07T12:01:08.265880Z"},"links":{"citing_paper":"/paper/2506.00782"},"observation_digest":"sha256:795219a3567a26616bd07d745dbb7635e5fac7e7db1e0bfcb129ebcddc59bf10","observation_id":"0c83958e-51f1-4715-841a-38e611cdb273","resolution":{"observed_at":"2026-08-07T12:01:15.779030Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2108.07258","last_updated":"2022-07-12T23:45:14Z","snapshot_observed_at":"2026-08-02T09:20:40.804790Z","submitted_at":"2021-08-16T17:50:08Z","title":"On the Opportunities and Risks of Foundation Models","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2108.07258","snapshot_observed_at":"2026-08-07T12:01:08.323501Z","title":"Bommasani, D","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2506.00782","last_updated":"2025-06-01T02:19:46Z","snapshot_observed_at":"2026-08-07T11:55:45.889580Z","submitted_at":"2025-06-01T02:19:46Z","title":"Jailbreak-R1: Exploring the Jailbreak Capabilities of LLMs via Reinforcement Learning","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-07T12:01:08.323501Z"},"links":{"cited_paper":"/paper/2108.07258","citing_paper":"/paper/2506.00782"},"observation_digest":"sha256:c4a00ec8caffd912006c9dfcd48950bd003546da9c1ea6124fdc6f4015eb7946","observation_id":"bd7a3d64-e8c8-44d7-8978-302a0a69abae","resolution":{"observed_at":"2026-08-07T12:01:08.323501Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2310.08419","last_updated":"2024-07-18T18:24:57Z","snapshot_observed_at":"2026-08-12T12:29:45.113982Z","submitted_at":"2023-10-12T15:38:28Z","title":"Jailbreaking Black Box Large Language Models in Twenty Queries","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2310.08419","snapshot_observed_at":"2026-08-07T12:01:08.370972Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.00782","last_updated":"2025-06-01T02:19:46Z","snapshot_observed_at":"2026-08-07T11:55:45.889580Z","submitted_at":"2025-06-01T02:19:46Z","title":"Jailbreak-R1: Exploring the Jailbreak Capabilities of LLMs via Reinforcement Learning","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-07T12:01:08.370972Z"},"links":{"cited_paper":"/paper/2310.08419","citing_paper":"/paper/2506.00782"},"observation_digest":"sha256:969a5a6ecc93326fc184b9bf4be8314d234f78247c4c881a90aa58a7d872f797","observation_id":"f393ed59-e8d9-45e9-8660-c820a41aa1e5","resolution":{"observed_at":"2026-08-07T12:01:08.370972Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:01:15.609580Z","title":"Chiang, L","venue":null,"work_id":"5d5f1a97-491d-4da1-a49b-751d865174ed","year":2024},"citing_paper":{"arxiv_id":"2506.00782","last_updated":"2025-06-01T02:19:46Z","snapshot_observed_at":"2026-08-07T11:55:45.889580Z","submitted_at":"2025-06-01T02:19:46Z","title":"Jailbreak-R1: Exploring the Jailbreak Capabilities of LLMs via Reinforcement Learning","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-07T12:01:08.431421Z"},"links":{"citing_paper":"/paper/2506.00782"},"observation_digest":"sha256:99525dcb0c39b8abdc59cbcaddfcd3770736a2c3906b75842f8d361c0c1c95ac","observation_id":"b364c890-f672-4494-8c4e-0c3ca41f3b99","resolution":{"observed_at":"2026-08-07T12:01:15.678396Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:01:15.489379Z","title":null,"venue":null,"work_id":"9c2f42a3-1418-440b-b439-4d8a7478abee","year":2024},"citing_paper":{"arxiv_id":"2506.00782","last_updated":"2025-06-01T02:19:46Z","snapshot_observed_at":"2026-08-07T11:55:45.889580Z","submitted_at":"2025-06-01T02:19:46Z","title":"Jailbreak-R1: Exploring the Jailbreak Capabilities of LLMs via Reinforcement Learning","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-07T12:01:08.467412Z"},"links":{"citing_paper":"/paper/2506.00782"},"observation_digest":"sha256:88f779e40020bf510de2ff7d1c176207bbd8eff4f00fb98efc72069c5a76f459","observation_id":"3a3d76af-8b39-4115-a880-59665351a6f2","resolution":{"observed_at":"2026-08-07T12:01:15.529872Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2501.12948","last_updated":"2026-01-04T03:57:36Z","snapshot_observed_at":"2026-08-13T15:58:13.809876Z","submitted_at":"2025-01-22T15:19:35Z","title":"DeepSeek-R1: Incentivizing Reasoning Capability in LLMs via Reinforcement Learning","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2501.12948","snapshot_observed_at":"2026-08-07T12:01:08.506447Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2506.00782","last_updated":"2025-06-01T02:19:46Z","snapshot_observed_at":"2026-08-07T11:55:45.889580Z","submitted_at":"2025-06-01T02:19:46Z","title":"Jailbreak-R1: Exploring the Jailbreak Capabilities of LLMs via Reinforcement Learning","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-07T12:01:08.506447Z"},"links":{"cited_paper":"/paper/2501.12948","citing_paper":"/paper/2506.00782"},"observation_digest":"sha256:68c2a108c45b5b329ec16a1185088f1a885a349f37f992a64ae4d76c25bfd217","observation_id":"673ba450-cba6-4eeb-b443-628662efb98e","resolution":{"observed_at":"2026-08-07T12:01:08.506447Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2407.21783","last_updated":"2024-11-23T23:27:33Z","snapshot_observed_at":"2026-08-13T17:20:44.002518Z","submitted_at":"2024-07-31T17:54:27Z","title":"The Llama 3 Herd of Models","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2407.21783","snapshot_observed_at":"2026-08-07T12:01:08.542610Z","title":"Grattafiori, A","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.00782","last_updated":"2025-06-01T02:19:46Z","snapshot_observed_at":"2026-08-07T11:55:45.889580Z","submitted_at":"2025-06-01T02:19:46Z","title":"Jailbreak-R1: Exploring the Jailbreak Capabilities of LLMs via Reinforcement Learning","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-07T12:01:08.542610Z"},"links":{"cited_paper":"/paper/2407.21783","citing_paper":"/paper/2506.00782"},"observation_digest":"sha256:f2ea48fe5a345d6e8242182cb49c6274e38aa21c4354b8d09312ae0ea8e57c00","observation_id":"c18d2fbe-eeb3-4382-a8db-52aef4f2b1d5","resolution":{"observed_at":"2026-08-07T12:01:08.542610Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:01:15.393259Z","title":null,"venue":null,"work_id":"f83f505c-fc1b-4106-a339-1780eca1330a","year":null},"citing_paper":{"arxiv_id":"2506.00782","last_updated":"2025-06-01T02:19:46Z","snapshot_observed_at":"2026-08-07T11:55:45.889580Z","submitted_at":"2025-06-01T02:19:46Z","title":"Jailbreak-R1: Exploring the Jailbreak Capabilities of LLMs via Reinforcement Learning","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-07T12:01:08.618088Z"},"links":{"citing_paper":"/paper/2506.00782"},"observation_digest":"sha256:21b2999e0090c65fb1793de81dbfa0076d73321e42399becc124e34c8020a200","observation_id":"d985b050-1d04-41e4-95bc-c5fb7d70cc38","resolution":{"observed_at":"2026-08-07T12:01:15.437821Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:01:15.276357Z","title":null,"venue":null,"work_id":"c8872d2f-99a6-4a57-acc0-5a93b1985040","year":2024},"citing_paper":{"arxiv_id":"2506.00782","last_updated":"2025-06-01T02:19:46Z","snapshot_observed_at":"2026-08-07T11:55:45.889580Z","submitted_at":"2025-06-01T02:19:46Z","title":"Jailbreak-R1: Exploring the Jailbreak Capabilities of LLMs via Reinforcement Learning","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-07T12:01:08.659593Z"},"links":{"citing_paper":"/paper/2506.00782"},"observation_digest":"sha256:03308e213b148916f020ba71835b306245e0f30c34ac93ec3421052882b6dec6","observation_id":"072fc78b-14de-47d8-9eb1-8f1452568d74","resolution":{"observed_at":"2026-08-07T12:01:15.329250Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2412.03556","last_updated":"2024-12-19T22:37:45Z","snapshot_observed_at":"2026-08-14T18:59:07.584753Z","submitted_at":"2024-12-04T18:51:32Z","title":"Best-of-N Jailbreaking","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2412.03556","snapshot_observed_at":"2026-08-07T12:01:08.712974Z","title":"Hughes, S","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.00782","last_updated":"2025-06-01T02:19:46Z","snapshot_observed_at":"2026-08-07T11:55:45.889580Z","submitted_at":"2025-06-01T02:19:46Z","title":"Jailbreak-R1: Exploring the Jailbreak Capabilities of LLMs via Reinforcement Learning","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-07T12:01:08.712974Z"},"links":{"cited_paper":"/paper/2412.03556","citing_paper":"/paper/2506.00782"},"observation_digest":"sha256:0d4240212fe6a87eaa598ea3befbd4abf091764769abe2415541aa3052876ade","observation_id":"ca9c6f7a-6ddd-4ef9-9e2c-e833b8540891","resolution":{"observed_at":"2026-08-07T12:01:08.712974Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2406.15513","last_updated":"2025-06-14T16:04:31Z","snapshot_observed_at":"2026-08-12T23:38:02.782103Z","submitted_at":"2024-06-20T18:37:36Z","title":"PKU-SafeRLHF: Towards Multi-Level Safety Alignment for LLMs with Human Preference","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2406.15513","snapshot_observed_at":"2026-08-07T12:01:08.749164Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.00782","last_updated":"2025-06-01T02:19:46Z","snapshot_observed_at":"2026-08-07T11:55:45.889580Z","submitted_at":"2025-06-01T02:19:46Z","title":"Jailbreak-R1: Exploring the Jailbreak Capabilities of LLMs via Reinforcement Learning","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-07T12:01:08.749164Z"},"links":{"cited_paper":"/paper/2406.15513","citing_paper":"/paper/2506.00782"},"observation_digest":"sha256:d7569b676524fa1ba61567f9c24e9afe10e065835e26a0fdc7b86f0e7413b8d5","observation_id":"eefbd577-524a-4cc1-a8d0-3faa2c8147af","resolution":{"observed_at":"2026-08-07T12:01:08.749164Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:01:15.149348Z","title":"Jiang, K","venue":null,"work_id":"280737cd-23d5-47a6-840e-aec9e3e838fd","year":2024},"citing_paper":{"arxiv_id":"2506.00782","last_updated":"2025-06-01T02:19:46Z","snapshot_observed_at":"2026-08-07T11:55:45.889580Z","submitted_at":"2025-06-01T02:19:46Z","title":"Jailbreak-R1: Exploring the Jailbreak Capabilities of LLMs via Reinforcement Learning","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-07T12:01:08.790854Z"},"links":{"citing_paper":"/paper/2506.00782"},"observation_digest":"sha256:4daf4f2b23519cf7f5a862591544c0d1327a4aeb4001f89f41c5fe58ed807d4b","observation_id":"f96588aa-b5a8-47c9-a3a3-77cb239334db","resolution":{"observed_at":"2026-08-07T12:01:15.216923Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2405.18540","last_updated":"2025-02-28T14:49:25Z","snapshot_observed_at":"2026-08-12T23:55:47.295422Z","submitted_at":"2024-05-28T19:16:17Z","title":"Learning diverse attacks on large language models for robust red-teaming and safety tuning","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2405.18540","snapshot_observed_at":"2026-08-07T12:01:08.855205Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.00782","last_updated":"2025-06-01T02:19:46Z","snapshot_observed_at":"2026-08-07T11:55:45.889580Z","submitted_at":"2025-06-01T02:19:46Z","title":"Jailbreak-R1: Exploring the Jailbreak Capabilities of LLMs via Reinforcement Learning","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-07T12:01:08.855205Z"},"links":{"cited_paper":"/paper/2405.18540","citing_paper":"/paper/2506.00782"},"observation_digest":"sha256:a35130866947089bed24bcf8e219d4dc1f835272b87f49848d963e4db3addceb","observation_id":"8b7839bf-1144-4e59-9590-e49c9f2bbb38","resolution":{"observed_at":"2026-08-07T12:01:08.855205Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:01:15.035699Z","title":null,"venue":null,"work_id":"f32c5ad7-323c-4289-a088-986ba6141822","year":2025},"citing_paper":{"arxiv_id":"2506.00782","last_updated":"2025-06-01T02:19:46Z","snapshot_observed_at":"2026-08-07T11:55:45.889580Z","submitted_at":"2025-06-01T02:19:46Z","title":"Jailbreak-R1: Exploring the Jailbreak Capabilities of LLMs via Reinforcement Learning","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-07T12:01:08.904306Z"},"links":{"citing_paper":"/paper/2506.00782"},"observation_digest":"sha256:775f8a7c3e7ab5564c416bf01e8e37e976a51949e7f7401179b85c47938915be","observation_id":"d9d7b985-ec8f-438f-b860-4a5163b078c8","resolution":{"observed_at":"2026-08-07T12:01:15.081114Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2404.07921","last_updated":"2024-11-24T18:03:43Z","snapshot_observed_at":"2026-08-13T00:32:28.634791Z","submitted_at":"2024-04-11T17:05:50Z","title":"AmpleGCG: Learning a Universal and Transferable Generative Model of Adversarial Suffixes for Jailbreaking Both Open and Closed LLMs","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2404.07921","snapshot_observed_at":"2026-08-07T12:01:08.949311Z","title":"Liao and H","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.00782","last_updated":"2025-06-01T02:19:46Z","snapshot_observed_at":"2026-08-07T11:55:45.889580Z","submitted_at":"2025-06-01T02:19:46Z","title":"Jailbreak-R1: Exploring the Jailbreak Capabilities of LLMs via Reinforcement Learning","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-07T12:01:08.949311Z"},"links":{"cited_paper":"/paper/2404.07921","citing_paper":"/paper/2506.00782"},"observation_digest":"sha256:a7dc57836f233076d472ad53eecba0c3af1cb3b91dcf8cb46c8ac4626851c044","observation_id":"caa11580-6c71-4128-ad4f-253b6c47ab5d","resolution":{"observed_at":"2026-08-07T12:01:08.949311Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2410.05295","last_updated":"2025-04-22T05:20:39Z","snapshot_observed_at":"2026-08-12T22:31:22.205885Z","submitted_at":"2024-10-03T17:59:01Z","title":"AutoDAN-Turbo: A Lifelong Agent for Strategy Self-Exploration to Jailbreak LLMs","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2410.05295","snapshot_observed_at":"2026-08-07T12:01:09.010611Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.00782","last_updated":"2025-06-01T02:19:46Z","snapshot_observed_at":"2026-08-07T11:55:45.889580Z","submitted_at":"2025-06-01T02:19:46Z","title":"Jailbreak-R1: Exploring the Jailbreak Capabilities of LLMs via Reinforcement Learning","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-07T12:01:09.010611Z"},"links":{"cited_paper":"/paper/2410.05295","citing_paper":"/paper/2506.00782"},"observation_digest":"sha256:1c3e2a441941524c4a079595a96e1105347fbd2d184888f6ef14d10c017bb72d","observation_id":"33b04a5e-5201-4103-a505-f126f201da8a","resolution":{"observed_at":"2026-08-07T12:01:09.010611Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:01:14.865966Z","title":null,"venue":null,"work_id":"e940ec46-b532-441f-9afa-1afb79d51871","year":2024},"citing_paper":{"arxiv_id":"2506.00782","last_updated":"2025-06-01T02:19:46Z","snapshot_observed_at":"2026-08-07T11:55:45.889580Z","submitted_at":"2025-06-01T02:19:46Z","title":"Jailbreak-R1: Exploring the Jailbreak Capabilities of LLMs via Reinforcement Learning","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-07T12:01:09.049209Z"},"links":{"citing_paper":"/paper/2506.00782"},"observation_digest":"sha256:7c9ee8e28115f6032da0ceca67ee7d2a952ceb7cfab5033b15b3ffdfe72b64c6","observation_id":"79503cc3-a8ae-4757-97cc-c009a116ff06","resolution":{"observed_at":"2026-08-07T12:01:14.920262Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2501.01830","last_updated":"2025-01-03T14:30:14Z","snapshot_observed_at":"2026-08-15T00:57:40.328423Z","submitted_at":"2025-01-03T14:30:14Z","title":"Auto-RT: Automatic Jailbreak Strategy Exploration for Red-Teaming Large Language Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2501.01830","snapshot_observed_at":"2026-08-07T12:01:09.082636Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2506.00782","last_updated":"2025-06-01T02:19:46Z","snapshot_observed_at":"2026-08-07T11:55:45.889580Z","submitted_at":"2025-06-01T02:19:46Z","title":"Jailbreak-R1: Exploring the Jailbreak Capabilities of LLMs via Reinforcement Learning","version":1},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-07T12:01:09.082636Z"},"links":{"cited_paper":"/paper/2501.01830","citing_paper":"/paper/2506.00782"},"observation_digest":"sha256:2bc43d9f9a18c952f9288bd18b10e9b86262fbaf619e468273da9deceb9340a5","observation_id":"7ef22d1b-236d-4d76-b9a5-70094e50e563","resolution":{"observed_at":"2026-08-07T12:01:09.082636Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:01:14.722279Z","title":"Mazeika, L","venue":null,"work_id":"45c80049-022f-4436-9bbf-2aa4280ef2c1","year":2024},"citing_paper":{"arxiv_id":"2506.00782","last_updated":"2025-06-01T02:19:46Z","snapshot_observed_at":"2026-08-07T11:55:45.889580Z","submitted_at":"2025-06-01T02:19:46Z","title":"Jailbreak-R1: Exploring the Jailbreak Capabilities of LLMs via Reinforcement Learning","version":1},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-07T12:01:09.159736Z"},"links":{"citing_paper":"/paper/2506.00782"},"observation_digest":"sha256:cb3d5cd8d14242915120af3fb6fa0f619a6b8d14381afacd34040f026644d333","observation_id":"9f76d43c-b567-41d5-8d90-ffe9b0a7e40a","resolution":{"observed_at":"2026-08-07T12:01:14.799153Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:01:14.580024Z","title":"Mehrotra, M","venue":null,"work_id":"28e2fc39-b130-4ec3-8f63-9f8694950bab","year":2024},"citing_paper":{"arxiv_id":"2506.00782","last_updated":"2025-06-01T02:19:46Z","snapshot_observed_at":"2026-08-07T11:55:45.889580Z","submitted_at":"2025-06-01T02:19:46Z","title":"Jailbreak-R1: Exploring the Jailbreak Capabilities of LLMs via Reinforcement Learning","version":1},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-07T12:01:09.219879Z"},"links":{"citing_paper":"/paper/2506.00782"},"observation_digest":"sha256:0bdafea5e2ca8bd160dc4b79583722a58ce5ec737567b1e09b6bdad9c583c341","observation_id":"b1e15a24-cb77-4191-9ab0-92c61ff84c58","resolution":{"observed_at":"2026-08-07T12:01:14.626933Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:01:14.407513Z","title":"Gpt-3.5 turbo, 2023","venue":null,"work_id":"3b68ca0f-5da9-49e6-9294-250cc5195d7e","year":2023},"citing_paper":{"arxiv_id":"2506.00782","last_updated":"2025-06-01T02:19:46Z","snapshot_observed_at":"2026-08-07T11:55:45.889580Z","submitted_at":"2025-06-01T02:19:46Z","title":"Jailbreak-R1: Exploring the Jailbreak Capabilities of LLMs via Reinforcement Learning","version":1},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-07T12:01:09.278456Z"},"links":{"citing_paper":"/paper/2506.00782"},"observation_digest":"sha256:48eca99da19079403f14ffede05f14b57e1b2ddc4e3e8bf2d6431532aa650d70","observation_id":"566053bd-80f3-4d37-853f-df3a49293b28","resolution":{"observed_at":"2026-08-07T12:01:14.498579Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:01:14.241486Z","title":"Gpt-4o system card, 2024a","venue":null,"work_id":"9d1308e6-c4e7-4f6d-919f-8c3161359b4d","year":2024},"citing_paper":{"arxiv_id":"2506.00782","last_updated":"2025-06-01T02:19:46Z","snapshot_observed_at":"2026-08-07T11:55:45.889580Z","submitted_at":"2025-06-01T02:19:46Z","title":"Jailbreak-R1: Exploring the Jailbreak Capabilities of LLMs via Reinforcement Learning","version":1},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-07T12:01:09.326484Z"},"links":{"citing_paper":"/paper/2506.00782"},"observation_digest":"sha256:ccd5da2266ee228751d0266aa5d7d592d901d7528dd1684900a97fc03caaf58c","observation_id":"626e1ff1-468b-4aaa-bfb7-e71a93d30c8f","resolution":{"observed_at":"2026-08-07T12:01:14.309406Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2404.16873","last_updated":"2025-06-02T18:59:01Z","snapshot_observed_at":"2026-08-13T00:25:07.154522Z","submitted_at":"2024-04-21T22:18:13Z","title":"AdvPrompter: Fast Adaptive Adversarial Prompting for LLMs","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2404.16873","snapshot_observed_at":"2026-08-07T12:01:09.355215Z","title":"Paulus, A","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.00782","last_updated":"2025-06-01T02:19:46Z","snapshot_observed_at":"2026-08-07T11:55:45.889580Z","submitted_at":"2025-06-01T02:19:46Z","title":"Jailbreak-R1: Exploring the Jailbreak Capabilities of LLMs via Reinforcement Learning","version":1},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-08-07T12:01:09.355215Z"},"links":{"cited_paper":"/paper/2404.16873","citing_paper":"/paper/2506.00782"},"observation_digest":"sha256:553621925221eee46baf4e314ae5b604cb509d3a457c9b8d9267ffb9d1e48014","observation_id":"08782bc4-4c05-447a-8f7a-e6054cf6024a","resolution":{"observed_at":"2026-08-07T12:01:09.355215Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:01:14.036058Z","title":"Perez, S","venue":null,"work_id":"604bba43-7e9d-4e6e-96e8-077007903d1a","year":2022},"citing_paper":{"arxiv_id":"2506.00782","last_updated":"2025-06-01T02:19:46Z","snapshot_observed_at":"2026-08-07T11:55:45.889580Z","submitted_at":"2025-06-01T02:19:46Z","title":"Jailbreak-R1: Exploring the Jailbreak Capabilities of LLMs via Reinforcement Learning","version":1},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-08-07T12:01:09.433892Z"},"links":{"citing_paper":"/paper/2506.00782"},"observation_digest":"sha256:485cb2649137d0d2cd3ffbfac69912be6871646cf8876c0d2556084b6a999c1d","observation_id":"e8db39e9-155c-47b6-9fc9-841594d08b36","resolution":{"observed_at":"2026-08-07T12:01:14.151394Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2504.13958","last_updated":"2025-04-16T21:45:32Z","snapshot_observed_at":"2026-08-15T01:33:03.364074Z","submitted_at":"2025-04-16T21:45:32Z","title":"ToolRL: Reward is All Tool Learning Needs","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2504.13958","snapshot_observed_at":"2026-08-07T12:01:09.512168Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2506.00782","last_updated":"2025-06-01T02:19:46Z","snapshot_observed_at":"2026-08-07T11:55:45.889580Z","submitted_at":"2025-06-01T02:19:46Z","title":"Jailbreak-R1: Exploring the Jailbreak Capabilities of LLMs via Reinforcement Learning","version":1},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-08-07T12:01:09.512168Z"},"links":{"cited_paper":"/paper/2504.13958","citing_paper":"/paper/2506.00782"},"observation_digest":"sha256:e20b82b9ec77028ccb071da1a5070477d64222ced229fb09dc8c235e02684ec8","observation_id":"8608203b-ab0d-4b7d-9e6d-5f5952b7c7aa","resolution":{"observed_at":"2026-08-07T12:01:09.512168Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:01:13.780458Z","title":"Samvelyan, S","venue":null,"work_id":"45cc2aca-2952-42b6-9588-84b4c0bc4f56","year":2024},"citing_paper":{"arxiv_id":"2506.00782","last_updated":"2025-06-01T02:19:46Z","snapshot_observed_at":"2026-08-07T11:55:45.889580Z","submitted_at":"2025-06-01T02:19:46Z","title":"Jailbreak-R1: Exploring the Jailbreak Capabilities of LLMs via Reinforcement Learning","version":1},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-08-07T12:01:09.600327Z"},"links":{"citing_paper":"/paper/2506.00782"},"observation_digest":"sha256:7fe0e76686527a7f453f4b798dacf10ea35b29931201ef453565f9bebca7b779","observation_id":"a61ec825-55bf-40eb-92e3-e9999b760f4e","resolution":{"observed_at":"2026-08-07T12:01:13.886647Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1707.06347","last_updated":"2017-08-28T09:20:06Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2017-07-20T02:32:33Z","title":"Proximal Policy Optimization Algorithms","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1707.06347","snapshot_observed_at":"2026-08-07T12:01:09.657922Z","title":"Schulman, F","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2506.00782","last_updated":"2025-06-01T02:19:46Z","snapshot_observed_at":"2026-08-07T11:55:45.889580Z","submitted_at":"2025-06-01T02:19:46Z","title":"Jailbreak-R1: Exploring the Jailbreak Capabilities of LLMs via Reinforcement Learning","version":1},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-08-07T12:01:09.657922Z"},"links":{"cited_paper":"/paper/1707.06347","citing_paper":"/paper/2506.00782"},"observation_digest":"sha256:ee1444c0d1027b20aee2f36986d3c920c6cfc74aea464092de0fdef6cc964c62","observation_id":"2fe3d659-1d9e-4572-83d3-d16129c3df13","resolution":{"observed_at":"2026-08-07T12:01:09.657922Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:01:13.553746Z","title":"Shaikh, H","venue":null,"work_id":"cf609089-76fb-48bc-aa30-3cca290abed6","year":2023},"citing_paper":{"arxiv_id":"2506.00782","last_updated":"2025-06-01T02:19:46Z","snapshot_observed_at":"2026-08-07T11:55:45.889580Z","submitted_at":"2025-06-01T02:19:46Z","title":"Jailbreak-R1: Exploring the Jailbreak Capabilities of LLMs via Reinforcement Learning","version":1},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-08-07T12:01:09.746566Z"},"links":{"citing_paper":"/paper/2506.00782"},"observation_digest":"sha256:648c6d6ee584b412634adb71e9debab367e27c704da5e11ae0bada62513e506f","observation_id":"337364ca-5d04-4c9d-aa9e-140249eaeb30","resolution":{"observed_at":"2026-08-07T12:01:13.639232Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2402.03300","last_updated":"2024-04-27T15:25:53Z","snapshot_observed_at":"2026-08-06T14:58:42.911363Z","submitted_at":"2024-02-05T18:55:32Z","title":"DeepSeekMath: Pushing the Limits of Mathematical Reasoning in Open Language Models","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.03300","snapshot_observed_at":"2026-08-07T12:01:09.833907Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.00782","last_updated":"2025-06-01T02:19:46Z","snapshot_observed_at":"2026-08-07T11:55:45.889580Z","submitted_at":"2025-06-01T02:19:46Z","title":"Jailbreak-R1: Exploring the Jailbreak Capabilities of LLMs via Reinforcement Learning","version":1},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-08-07T12:01:09.833907Z"},"links":{"cited_paper":"/paper/2402.03300","citing_paper":"/paper/2506.00782"},"observation_digest":"sha256:d7084fbb0dd05cb1fe78f775582571528e84c928ccb14b971cb3913770ffad4e","observation_id":"33a0d048-074e-4b90-8607-1d344d8b45c1","resolution":{"observed_at":"2026-08-07T12:01:09.833907Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:01:09.906691Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2506.00782","last_updated":"2025-06-01T02:19:46Z","snapshot_observed_at":"2026-08-07T11:55:45.889580Z","submitted_at":"2025-06-01T02:19:46Z","title":"Jailbreak-R1: Exploring the Jailbreak Capabilities of LLMs via Reinforcement Learning","version":1},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-08-07T12:01:09.906691Z"},"links":{"citing_paper":"/paper/2506.00782"},"observation_digest":"sha256:476c46cc70e1d380c5478fd8f16f84a007aaba435afc20c4a4bb144ce1ca189e","observation_id":"1da0f343-f8de-4521-ae3e-d911e0b7fecd","resolution":{"observed_at":"2026-08-07T12:01:09.906691Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2307.09288","last_updated":"2023-07-19T17:08:59Z","snapshot_observed_at":"2026-08-07T12:56:43.323460Z","submitted_at":"2023-07-18T14:31:57Z","title":"Llama 2: Open Foundation and Fine-Tuned Chat Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2307.09288","snapshot_observed_at":"2026-08-07T12:01:10.034542Z","title":"Touvron, L","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.00782","last_updated":"2025-06-01T02:19:46Z","snapshot_observed_at":"2026-08-07T11:55:45.889580Z","submitted_at":"2025-06-01T02:19:46Z","title":"Jailbreak-R1: Exploring the Jailbreak Capabilities of LLMs via Reinforcement Learning","version":1},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-08-07T12:01:10.034542Z"},"links":{"cited_paper":"/paper/2307.09288","citing_paper":"/paper/2506.00782"},"observation_digest":"sha256:8a6aed3009f08c4b436f81492dae0a83c517106c160a4df692263076c2e6a08e","observation_id":"c80dcfb9-4c3d-4a0d-b3d0-46c2a6f5d20a","resolution":{"observed_at":"2026-08-07T12:01:10.034542Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:01:13.304961Z","title":"Wang and K","venue":null,"work_id":"655a5e61-9e69-4ef7-8208-8485c90f03fb","year":2024},"citing_paper":{"arxiv_id":"2506.00782","last_updated":"2025-06-01T02:19:46Z","snapshot_observed_at":"2026-08-07T11:55:45.889580Z","submitted_at":"2025-06-01T02:19:46Z","title":"Jailbreak-R1: Exploring the Jailbreak Capabilities of LLMs via Reinforcement Learning","version":1},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-08-07T12:01:10.174828Z"},"links":{"citing_paper":"/paper/2506.00782"},"observation_digest":"sha256:a4b8967e9f4e18d3edf084aba9547f6571b92d2446afc2060f38a44d88e71347","observation_id":"20bb5f9f-9282-4eea-9926-6fe1ae134672","resolution":{"observed_at":"2026-08-07T12:01:13.402890Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2407.10671","last_updated":"2024-09-10T13:25:53Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-07-15T12:35:42Z","title":"Qwen2 Technical Report","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2407.10671","snapshot_observed_at":"2026-08-07T12:01:10.230800Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.00782","last_updated":"2025-06-01T02:19:46Z","snapshot_observed_at":"2026-08-07T11:55:45.889580Z","submitted_at":"2025-06-01T02:19:46Z","title":"Jailbreak-R1: Exploring the Jailbreak Capabilities of LLMs via Reinforcement Learning","version":1},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-08-07T12:01:10.230800Z"},"links":{"cited_paper":"/paper/2407.10671","citing_paper":"/paper/2506.00782"},"observation_digest":"sha256:ae179c35ba7196bf2165361436989ddad196f3449ab9a8831b8c47823148ceef","observation_id":"9116b090-aef8-4210-95f5-bf89a5cdba32","resolution":{"observed_at":"2026-08-07T12:01:10.230800Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:01:13.075965Z","title":null,"venue":null,"work_id":"caf61788-9b38-4e7e-84c0-47b84483f529","year":2024},"citing_paper":{"arxiv_id":"2506.00782","last_updated":"2025-06-01T02:19:46Z","snapshot_observed_at":"2026-08-07T11:55:45.889580Z","submitted_at":"2025-06-01T02:19:46Z","title":"Jailbreak-R1: Exploring the Jailbreak Capabilities of LLMs via Reinforcement Learning","version":1},"reference_index":36,"source":"pdf_text","source_observed_at":"2026-08-07T12:01:10.304646Z"},"links":{"citing_paper":"/paper/2506.00782"},"observation_digest":"sha256:4bfdd4b096d5c7b8d899ca4169a9e252b8561ebfbfb7d68a329e1013a5608779","observation_id":"964183fa-aa52-49f2-927f-c5173047915a","resolution":{"observed_at":"2026-08-07T12:01:13.185963Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2502.02384","last_updated":"2025-06-27T07:30:35Z","snapshot_observed_at":"2026-08-15T02:30:06.598025Z","submitted_at":"2025-02-04T15:02:55Z","title":"STAIR: Improving Safety Alignment with Introspective Reasoning","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2502.02384","snapshot_observed_at":"2026-08-07T12:01:10.437566Z","title":"Zhang, S","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2506.00782","last_updated":"2025-06-01T02:19:46Z","snapshot_observed_at":"2026-08-07T11:55:45.889580Z","submitted_at":"2025-06-01T02:19:46Z","title":"Jailbreak-R1: Exploring the Jailbreak Capabilities of LLMs via Reinforcement Learning","version":1},"reference_index":37,"source":"pdf_text","source_observed_at":"2026-08-07T12:01:10.437566Z"},"links":{"cited_paper":"/paper/2502.02384","citing_paper":"/paper/2506.00782"},"observation_digest":"sha256:51b1ba0bcd0c20506522d5a9718671ab4fa3b026a8aa1720e6afbc1e99c2eeb5","observation_id":"d46e43ee-3901-486a-9347-9043cb9922c4","resolution":{"observed_at":"2026-08-07T12:01:10.437566Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:01:12.961673Z","title":null,"venue":null,"work_id":"21589045-5fc6-4a60-bc98-6c0fcef52adb","year":2024},"citing_paper":{"arxiv_id":"2506.00782","last_updated":"2025-06-01T02:19:46Z","snapshot_observed_at":"2026-08-07T11:55:45.889580Z","submitted_at":"2025-06-01T02:19:46Z","title":"Jailbreak-R1: Exploring the Jailbreak Capabilities of LLMs via Reinforcement Learning","version":1},"reference_index":38,"source":"pdf_text","source_observed_at":"2026-08-07T12:01:10.548907Z"},"links":{"citing_paper":"/paper/2506.00782"},"observation_digest":"sha256:fcdfa8b0db0e978bdd4dbfb51402ff29895a1b50073672c68e58e33d64179c9d","observation_id":"9be8f1ce-bb31-4409-9aea-d7454a72728f","resolution":{"observed_at":"2026-08-07T12:01:13.013773Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2406.10977","last_updated":"2024-06-16T15:24:50Z","snapshot_observed_at":"2026-08-12T23:41:43.369019Z","submitted_at":"2024-06-16T15:24:50Z","title":"Toward Optimal LLM Alignments Using Two-Player Games","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2406.10977","snapshot_observed_at":"2026-08-07T12:01:10.671950Z","title":"Zheng, H","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.00782","last_updated":"2025-06-01T02:19:46Z","snapshot_observed_at":"2026-08-07T11:55:45.889580Z","submitted_at":"2025-06-01T02:19:46Z","title":"Jailbreak-R1: Exploring the Jailbreak Capabilities of LLMs via Reinforcement Learning","version":1},"reference_index":39,"source":"pdf_text","source_observed_at":"2026-08-07T12:01:10.671950Z"},"links":{"cited_paper":"/paper/2406.10977","citing_paper":"/paper/2506.00782"},"observation_digest":"sha256:c2165d62f00e6e596de7df65bbce507a1de41e1bcbf38a1f2ebaa1fa67cd058c","observation_id":"0aeb746e-80aa-4229-83f4-d714ffbf2ddf","resolution":{"observed_at":"2026-08-07T12:01:10.671950Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2503.15754","last_updated":"2025-03-20T00:13:04Z","snapshot_observed_at":"2026-08-14T12:48:52.975244Z","submitted_at":"2025-03-20T00:13:04Z","title":"AutoRedTeamer: Autonomous Red Teaming with Lifelong Attack Integration","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2503.15754","snapshot_observed_at":"2026-08-07T12:01:10.771523Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2506.00782","last_updated":"2025-06-01T02:19:46Z","snapshot_observed_at":"2026-08-07T11:55:45.889580Z","submitted_at":"2025-06-01T02:19:46Z","title":"Jailbreak-R1: Exploring the Jailbreak Capabilities of LLMs via Reinforcement Learning","version":1},"reference_index":40,"source":"pdf_text","source_observed_at":"2026-08-07T12:01:10.771523Z"},"links":{"cited_paper":"/paper/2503.15754","citing_paper":"/paper/2506.00782"},"observation_digest":"sha256:4e45673149a47ab7dedcf526311b7e44cb5208b8a7bcef102c82cce9c3be8643","observation_id":"362e0e77-debc-4ddb-a8c9-f1c8227e1e3d","resolution":{"observed_at":"2026-08-07T12:01:10.771523Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2407.01850","last_updated":"2024-07-01T23:25:30Z","snapshot_observed_at":"2026-08-13T01:57:14.863803Z","submitted_at":"2024-07-01T23:25:30Z","title":"Purple-teaming LLMs with Adversarial Defender Training","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2407.01850","snapshot_observed_at":"2026-08-07T12:01:10.911575Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.00782","last_updated":"2025-06-01T02:19:46Z","snapshot_observed_at":"2026-08-07T11:55:45.889580Z","submitted_at":"2025-06-01T02:19:46Z","title":"Jailbreak-R1: Exploring the Jailbreak Capabilities of LLMs via Reinforcement Learning","version":1},"reference_index":41,"source":"pdf_text","source_observed_at":"2026-08-07T12:01:10.911575Z"},"links":{"cited_paper":"/paper/2407.01850","citing_paper":"/paper/2506.00782"},"observation_digest":"sha256:b252c56448b99fe73ba2b78a3ea92b760986c110d7ecea457e1d02d03654eb50","observation_id":"ed3ab69c-a3f5-45fb-a68a-4206b040c247","resolution":{"observed_at":"2026-08-07T12:01:10.911575Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2307.15043","last_updated":"2023-12-20T20:48:57Z","snapshot_observed_at":"2026-08-12T09:06:50.363435Z","submitted_at":"2023-07-27T17:49:12Z","title":"Universal and Transferable Adversarial Attacks on Aligned Language Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2307.15043","snapshot_observed_at":"2026-08-07T12:01:11.128250Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.00782","last_updated":"2025-06-01T02:19:46Z","snapshot_observed_at":"2026-08-07T11:55:45.889580Z","submitted_at":"2025-06-01T02:19:46Z","title":"Jailbreak-R1: Exploring the Jailbreak Capabilities of LLMs via Reinforcement Learning","version":1},"reference_index":42,"source":"pdf_text","source_observed_at":"2026-08-07T12:01:11.128250Z"},"links":{"cited_paper":"/paper/2307.15043","citing_paper":"/paper/2506.00782"},"observation_digest":"sha256:73b2aeacdbe7fcf290e042878b7f5682c0c3d00395c7865e70211dd34b8111b4","observation_id":"cc43c2c8-46e6-48aa-b081-3da843160ed5","resolution":{"observed_at":"2026-08-07T12:01:11.128250Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:01:12.740780Z","title":"After obtaining the filtered 2k samples, we prompt the Qwen2.5-7B-Instruct model to imitate the sample attack as an example","venue":null,"work_id":"0df61afa-a30f-4091-b960-0acc0c0c9ea8","year":null},"citing_paper":{"arxiv_id":"2506.00782","last_updated":"2025-06-01T02:19:46Z","snapshot_observed_at":"2026-08-07T11:55:45.889580Z","submitted_at":"2025-06-01T02:19:46Z","title":"Jailbreak-R1: Exploring the Jailbreak Capabilities of LLMs via Reinforcement Learning","version":1},"reference_index":43,"source":"pdf_text","source_observed_at":"2026-08-07T12:01:11.261804Z"},"links":{"citing_paper":"/paper/2506.00782"},"observation_digest":"sha256:d13e0d1e381cd065f996ba2077c8d449d80efdd5a1070f14bd57802e1e25bfe8","observation_id":"2d3ff433-976c-4255-ac9a-da42342f056e","resolution":{"observed_at":"2026-08-07T12:01:12.850546Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:01:12.534169Z","title":null,"venue":null,"work_id":"c31020b4-f80b-4e57-83bc-be5c338ba703","year":null},"citing_paper":{"arxiv_id":"2506.00782","last_updated":"2025-06-01T02:19:46Z","snapshot_observed_at":"2026-08-07T11:55:45.889580Z","submitted_at":"2025-06-01T02:19:46Z","title":"Jailbreak-R1: Exploring the Jailbreak Capabilities of LLMs via Reinforcement Learning","version":1},"reference_index":44,"source":"pdf_text","source_observed_at":"2026-08-07T12:01:11.473485Z"},"links":{"citing_paper":"/paper/2506.00782"},"observation_digest":"sha256:6f2be254713ae297ffa4958d9dc76f5e9ef83d88c3b095bd3ee5c40bccd8003e","observation_id":"e1cf1b40-4758-4b2e-8d33-9e64c96a27d7","resolution":{"observed_at":"2026-08-07T12:01:12.612250Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}}],"paper":{"arxiv_id":"2506.00782","last_updated":"2025-06-01T02:19:46Z","latest_version":1,"primary_category":"cs.AI","snapshot_observed_at":"2026-08-07T11:55:45.889580Z","submitted_at":"2025-06-01T02:19:46Z","title":"Jailbreak-R1: Exploring the Jailbreak Capabilities of LLMs via Reinforcement Learning"},"reference_resolution":{"displayed":44,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":31,"verified_exact":0,"verified_fuzzy":13},"total_outbound_references":44},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"thesis":"As of 15 August 2026, this Paper Citation Record lists 44 of 44 outbound references and 8 inbound Pith citation observations for arXiv:2506.00782."}