{"as_of":"2026-08-10T12:37:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:0b6ceaa9b9de7ac79813b68211b2ff4352c0492d6904f2be549f639452b627cf","coverage":[{"denominator":58,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":58,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-07T05:47:06.558987Z","state":"measured"},{"denominator":60,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":60,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-10T06:31:04.303077+00:00","state":"measured"},{"denominator":2,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":2,"source":"paper_references, paper_reference_links","source_observed_at":"2026-06-25T22:12:27.301100Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"arxiv_reference","source_observed_at":"2026-07-04T19:00:04.605664Z","state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2506.07121","last_updated":"2026-08-01T10:21:24Z","snapshot_observed_at":"2026-08-08T16:50:44.576571Z","submitted_at":"2025-06-08T13:07:41Z","title":"Quality-Diversity Red-Teaming: Automated Generation of High-Quality and Diverse Attackers for Large Language Models","version":2},"cited_work":{"arxiv_id":"2506.07121","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2506.07121","snapshot_observed_at":"2026-08-04T00:35:57.161442Z","title":"arXiv preprint arXiv:2506.07121 (2025)","venue":null,"work_id":"cd977e73-c80f-4495-a5a1-4ca57eacb431","year":2025},"citing_paper":{"arxiv_id":"2601.19562","last_updated":"2026-05-15T09:01:29Z","snapshot_observed_at":"2026-07-06T22:43:12.468415Z","submitted_at":"2026-01-27T12:55:23Z","title":"Tournament Informed Adversarial Quality Diversity","version":2},"reference_index":39,"source":"pdf_text","source_observed_at":"2026-05-21T14:41:43.611099Z"},"links":{"cited_paper":"/paper/2506.07121","citing_paper":"/paper/2601.19562"},"observation_digest":"sha256:80186a69c7f8aa175fda4383e62182ac0f66ebcf24a05c32039f02f3006daa2d","observation_id":"f015c13a-2d8d-4790-8628-3127621d592f","resolution":{"observed_at":"2026-08-04T00:35:57.161442Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2506.07121","last_updated":"2026-08-01T10:21:24Z","snapshot_observed_at":"2026-08-08T16:50:44.576571Z","submitted_at":"2025-06-08T13:07:41Z","title":"Quality-Diversity Red-Teaming: Automated Generation of High-Quality and Diverse Attackers for Large Language Models","version":2},"cited_work":{"arxiv_id":"2506.07121","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2506.07121","snapshot_observed_at":"2026-08-04T00:35:57.161442Z","title":"arXiv preprint arXiv:2506.07121 (2025)","venue":null,"work_id":"cd977e73-c80f-4495-a5a1-4ca57eacb431","year":2025},"citing_paper":{"arxiv_id":"2606.24166","last_updated":"2026-06-23T05:40:05Z","snapshot_observed_at":"2026-07-06T23:58:49.574536Z","submitted_at":"2026-06-23T05:40:05Z","title":"Distributed Quality-Diversity Search for Toxicity in Large Language Models","version":1},"reference_index":52,"source":"pdf_text","source_observed_at":"2026-06-25T22:12:27.301100Z"},"links":{"cited_paper":"/paper/2506.07121","citing_paper":"/paper/2606.24166"},"observation_digest":"sha256:84bfdf3dbd80abbc9ee8a71ba8aa82caf75cd2c228cff85b8bef1ea65e7b1432","observation_id":"9e8e7acf-9393-4c24-af9a-9d35fa36ac03","resolution":{"observed_at":"2026-08-04T00:35:57.161442Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}}],"links":{"evidence":"/evidence","html":"/paper/2506.07121/citation-record","integrity":"/paper/2506.07121/integrity","json":"/paper/2506.07121/citation-record.json","paper":"/paper/2506.07121"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:47:11.818233Z","title":"Bäck.Evolutionary Algorithms in Theory and Practice: Evolution Strategies, Evolutionary Programming, Genetic Algorithms","venue":null,"work_id":"71e7bdbe-bf1c-47a4-8064-eea3859d855d","year":1996},"citing_paper":{"arxiv_id":"2506.07121","last_updated":"2026-08-01T10:21:24Z","snapshot_observed_at":"2026-08-08T16:50:44.576571Z","submitted_at":"2025-06-08T13:07:41Z","title":"Quality-Diversity Red-Teaming: Automated Generation of High-Quality and Diverse Attackers for Large Language Models","version":2},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-07T05:47:06.251667Z"},"links":{"citing_paper":"/paper/2506.07121"},"observation_digest":"sha256:05c97f9bb77ae4f7d64b6558fa5c3b46a4a9c850c55308cce8834dc0a9bd69fa","observation_id":"16b8b83b-c6ef-4787-8c66-4d730b2945c5","resolution":{"observed_at":"2026-08-07T05:47:11.891490Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2212.08073","last_updated":"2022-12-15T06:19:23Z","snapshot_observed_at":"2026-08-02T04:53:58.766070Z","submitted_at":"2022-12-15T06:19:23Z","title":"Constitutional AI: Harmlessness from AI Feedback","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2212.08073","snapshot_observed_at":"2026-08-07T05:47:06.256235Z","title":null,"venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2506.07121","last_updated":"2026-08-01T10:21:24Z","snapshot_observed_at":"2026-08-08T16:50:44.576571Z","submitted_at":"2025-06-08T13:07:41Z","title":"Quality-Diversity Red-Teaming: Automated Generation of High-Quality and Diverse Attackers for Large Language Models","version":2},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-07T05:47:06.256235Z"},"links":{"cited_paper":"/paper/2212.08073","citing_paper":"/paper/2506.07121"},"observation_digest":"sha256:0498d9011360e4d3da4481a999a0ec2c179ad6910ca0c5dbf639796beb60aa83","observation_id":"b45a99a4-a292-469a-a569-5218b2495979","resolution":{"observed_at":"2026-08-07T05:47:06.256235Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:47:11.691805Z","title":"Bengio, M","venue":null,"work_id":"9be03cfe-8b98-41b2-b9e6-8cd302a75865","year":2021},"citing_paper":{"arxiv_id":"2506.07121","last_updated":"2026-08-01T10:21:24Z","snapshot_observed_at":"2026-08-08T16:50:44.576571Z","submitted_at":"2025-06-08T13:07:41Z","title":"Quality-Diversity Red-Teaming: Automated Generation of High-Quality and Diverse Attackers for Large Language Models","version":2},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-07T05:47:06.260556Z"},"links":{"citing_paper":"/paper/2506.07121"},"observation_digest":"sha256:b6579ea65ba38328d5ff2857446ce33e1d264ba8efe8f19310057c4529f8ceda","observation_id":"e9dcd942-c6fd-41a4-92ee-878613cc5026","resolution":{"observed_at":"2026-08-07T05:47:11.747496Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2412.18693","last_updated":"2024-12-24T22:38:46Z","snapshot_observed_at":"2026-08-10T12:22:40.905976Z","submitted_at":"2024-12-24T22:38:46Z","title":"Diverse and Effective Red Teaming with Auto-generated Rewards and Multi-step Reinforcement Learning","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2412.18693","snapshot_observed_at":"2026-08-07T05:47:06.264820Z","title":"Beutel, K","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.07121","last_updated":"2026-08-01T10:21:24Z","snapshot_observed_at":"2026-08-08T16:50:44.576571Z","submitted_at":"2025-06-08T13:07:41Z","title":"Quality-Diversity Red-Teaming: Automated Generation of High-Quality and Diverse Attackers for Large Language Models","version":2},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-07T05:47:06.264820Z"},"links":{"cited_paper":"/paper/2412.18693","citing_paper":"/paper/2506.07121"},"observation_digest":"sha256:06411141ffa0069f0dfd221d4a6f004eaf259889e96cab961ebd3c660942557a","observation_id":"ac7ef433-3e74-412b-8fe7-9589df932fb0","resolution":{"observed_at":"2026-08-07T05:47:06.264820Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:47:11.494315Z","title":"Bhatt, B","venue":null,"work_id":"55e94193-2a66-41fd-814e-f3008f1bb665","year":2022},"citing_paper":{"arxiv_id":"2506.07121","last_updated":"2026-08-01T10:21:24Z","snapshot_observed_at":"2026-08-08T16:50:44.576571Z","submitted_at":"2025-06-08T13:07:41Z","title":"Quality-Diversity Red-Teaming: Automated Generation of High-Quality and Diverse Attackers for Large Language Models","version":2},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-07T05:47:06.269299Z"},"links":{"citing_paper":"/paper/2506.07121"},"observation_digest":"sha256:3fa7afb49cccaa01346f95c728bfd69873f025bb124039e0c3cc66fdce59b154","observation_id":"3141330c-abd4-4866-911e-a540ea84100b","resolution":{"observed_at":"2026-08-07T05:47:11.587281Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:47:11.361794Z","title":"Bianchi, M","venue":null,"work_id":"4b133ff0-3149-4091-a465-497e0c794fe6","year":2024},"citing_paper":{"arxiv_id":"2506.07121","last_updated":"2026-08-01T10:21:24Z","snapshot_observed_at":"2026-08-08T16:50:44.576571Z","submitted_at":"2025-06-08T13:07:41Z","title":"Quality-Diversity Red-Teaming: Automated Generation of High-Quality and Diverse Attackers for Large Language Models","version":2},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-07T05:47:06.273051Z"},"links":{"citing_paper":"/paper/2506.07121"},"observation_digest":"sha256:7ebd6fc6235250521c60be7d965bdf4ed0126521ddd752fd5d8c7e1f3a96dd10","observation_id":"205fa3cf-e466-49d4-841d-5844d4af3fdf","resolution":{"observed_at":"2026-08-07T05:47:11.447849Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2310.08419","last_updated":"2024-07-18T18:24:57Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2023-10-12T15:38:28Z","title":"Jailbreaking Black Box Large Language Models in Twenty Queries","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2310.08419","snapshot_observed_at":"2026-08-07T05:47:06.277530Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.07121","last_updated":"2026-08-01T10:21:24Z","snapshot_observed_at":"2026-08-08T16:50:44.576571Z","submitted_at":"2025-06-08T13:07:41Z","title":"Quality-Diversity Red-Teaming: Automated Generation of High-Quality and Diverse Attackers for Large Language Models","version":2},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-07T05:47:06.277530Z"},"links":{"cited_paper":"/paper/2310.08419","citing_paper":"/paper/2506.07121"},"observation_digest":"sha256:77432b1aa4f4dbc19f15a84aba585d0e94668cc2b5006a8f73f75fb880c36d19","observation_id":"c0505b0c-494e-4ba0-b255-77ad9efbf934","resolution":{"observed_at":"2026-08-07T05:47:06.277530Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:47:11.230821Z","title":"Chatzilygeroudis, A","venue":null,"work_id":"f582c507-4bec-430b-ba6f-21357be998ab","year":2021},"citing_paper":{"arxiv_id":"2506.07121","last_updated":"2026-08-01T10:21:24Z","snapshot_observed_at":"2026-08-08T16:50:44.576571Z","submitted_at":"2025-06-08T13:07:41Z","title":"Quality-Diversity Red-Teaming: Automated Generation of High-Quality and Diverse Attackers for Large Language Models","version":2},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-07T05:47:06.281915Z"},"links":{"citing_paper":"/paper/2506.07121"},"observation_digest":"sha256:52bb9b2760328f9a90b5e940d5ca1c1859c4ae26986ff3d21b2cbe893342456c","observation_id":"0bce8597-c33f-498b-841e-205498b47675","resolution":{"observed_at":"2026-08-07T05:47:11.292316Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:47:11.052839Z","title":"Cully, J","venue":null,"work_id":"f368ad30-eb24-47f0-a6c8-dd8882611463","year":2015},"citing_paper":{"arxiv_id":"2506.07121","last_updated":"2026-08-01T10:21:24Z","snapshot_observed_at":"2026-08-08T16:50:44.576571Z","submitted_at":"2025-06-08T13:07:41Z","title":"Quality-Diversity Red-Teaming: Automated Generation of High-Quality and Diverse Attackers for Large Language Models","version":2},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-07T05:47:06.285343Z"},"links":{"citing_paper":"/paper/2506.07121"},"observation_digest":"sha256:c0ec18eb801ebf5745af9f7d30a0bc01e92afc154acedf2b81d180f5ca216587","observation_id":"2779af8e-5a61-40dc-a169-88a2ce94f46e","resolution":{"observed_at":"2026-08-07T05:47:11.121094Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:47:10.934658Z","title":"Cully and Y","venue":null,"work_id":"df3a3f40-4396-4cb1-8ea8-f47021b3b1cc","year":2018},"citing_paper":{"arxiv_id":"2506.07121","last_updated":"2026-08-01T10:21:24Z","snapshot_observed_at":"2026-08-08T16:50:44.576571Z","submitted_at":"2025-06-08T13:07:41Z","title":"Quality-Diversity Red-Teaming: Automated Generation of High-Quality and Diverse Attackers for Large Language Models","version":2},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-07T05:47:06.289172Z"},"links":{"citing_paper":"/paper/2506.07121"},"observation_digest":"sha256:9c0c6ee26736477223f9d39eded427ffbee9cd14e79e6a205c27c8c22a3e9b01","observation_id":"6ac7622e-3a96-4669-b718-b99dc3abe6ff","resolution":{"observed_at":"2026-08-07T05:47:10.976374Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:47:10.800135Z","title":"Dathathri, A","venue":null,"work_id":"07afe18b-48fd-4914-bcb6-5cff5be738da","year":2020},"citing_paper":{"arxiv_id":"2506.07121","last_updated":"2026-08-01T10:21:24Z","snapshot_observed_at":"2026-08-08T16:50:44.576571Z","submitted_at":"2025-06-08T13:07:41Z","title":"Quality-Diversity Red-Teaming: Automated Generation of High-Quality and Diverse Attackers for Large Language Models","version":2},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-07T05:47:06.292756Z"},"links":{"citing_paper":"/paper/2506.07121"},"observation_digest":"sha256:88c239cd9c3f0340ba27eb0082f70cd93ed983a00d99262b8dff5571ded2cd93","observation_id":"52b78b70-fde6-4433-bcea-01cbdd5673dd","resolution":{"observed_at":"2026-08-07T05:47:10.844299Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1908.06083","last_updated":"2019-08-17T18:34:11Z","snapshot_observed_at":"2026-08-08T03:38:10.333686Z","submitted_at":"2019-08-17T18:34:11Z","title":"Build it Break it Fix it for Dialogue Safety: Robustness from Adversarial Human Attack","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1908.06083","snapshot_observed_at":"2026-08-07T05:47:06.296744Z","title":"Dinan, S","venue":null,"work_id":null,"year":1908},"citing_paper":{"arxiv_id":"2506.07121","last_updated":"2026-08-01T10:21:24Z","snapshot_observed_at":"2026-08-08T16:50:44.576571Z","submitted_at":"2025-06-08T13:07:41Z","title":"Quality-Diversity Red-Teaming: Automated Generation of High-Quality and Diverse Attackers for Large Language Models","version":2},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-07T05:47:06.296744Z"},"links":{"cited_paper":"/paper/1908.06083","citing_paper":"/paper/2506.07121"},"observation_digest":"sha256:691acfc04802bcf70499ded9ef1eda3c84be7c0eb20566f38099609b3a9d8e19","observation_id":"73945fed-74a1-482b-bf8d-7a752a747947","resolution":{"observed_at":"2026-08-07T05:47:06.296744Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2407.21783","last_updated":"2024-11-23T23:27:33Z","snapshot_observed_at":"2026-07-06T18:55:11.576666Z","submitted_at":"2024-07-31T17:54:27Z","title":"The Llama 3 Herd of Models","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2407.21783","snapshot_observed_at":"2026-08-07T05:47:06.300783Z","title":"Dubey, A","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.07121","last_updated":"2026-08-01T10:21:24Z","snapshot_observed_at":"2026-08-08T16:50:44.576571Z","submitted_at":"2025-06-08T13:07:41Z","title":"Quality-Diversity Red-Teaming: Automated Generation of High-Quality and Diverse Attackers for Large Language Models","version":2},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-07T05:47:06.300783Z"},"links":{"cited_paper":"/paper/2407.21783","citing_paper":"/paper/2506.07121"},"observation_digest":"sha256:157b2a176e8c6a5e31a723f0dddb88fa9b815dae3295fa7238717142eff550b0","observation_id":"375a866a-b92f-4ba6-bbaf-04ca2fac08c4","resolution":{"observed_at":"2026-08-07T05:47:06.300783Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:47:10.615440Z","title":"Ecoffet, J","venue":null,"work_id":"298eb8fe-4953-46b4-a847-ebf7de473969","year":2021},"citing_paper":{"arxiv_id":"2506.07121","last_updated":"2026-08-01T10:21:24Z","snapshot_observed_at":"2026-08-08T16:50:44.576571Z","submitted_at":"2025-06-08T13:07:41Z","title":"Quality-Diversity Red-Teaming: Automated Generation of High-Quality and Diverse Attackers for Large Language Models","version":2},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-07T05:47:06.304222Z"},"links":{"citing_paper":"/paper/2506.07121"},"observation_digest":"sha256:2b2df3c7cfec93ad88ca6be3422a6958a7175946db66be6b0317fd5f65614e00","observation_id":"9ef6d47e-f5a0-4dd4-8df4-a60d38d7cfec","resolution":{"observed_at":"2026-08-07T05:47:10.667358Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2211.02193","last_updated":"2022-11-04T00:14:42Z","snapshot_observed_at":"2026-07-06T14:14:18.434647Z","submitted_at":"2022-11-04T00:14:42Z","title":"Benchmarking Quality-Diversity Algorithms on Neuroevolution for Reinforcement Learning","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2211.02193","snapshot_observed_at":"2026-08-07T05:47:06.307492Z","title":"Flageat, B","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2506.07121","last_updated":"2026-08-01T10:21:24Z","snapshot_observed_at":"2026-08-08T16:50:44.576571Z","submitted_at":"2025-06-08T13:07:41Z","title":"Quality-Diversity Red-Teaming: Automated Generation of High-Quality and Diverse Attackers for Large Language Models","version":2},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-07T05:47:06.307492Z"},"links":{"cited_paper":"/paper/2211.02193","citing_paper":"/paper/2506.07121"},"observation_digest":"sha256:c9e711c3ac07e4afd2c140d093493f64d9ddfced4315b68b931efce23126f824","observation_id":"fcddd2d1-5c59-4c25-8599-be5603c40fb7","resolution":{"observed_at":"2026-08-07T05:47:06.307492Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:47:10.425922Z","title":null,"venue":null,"work_id":"569c32a2-e522-4d27-9c4b-c8c300d27d66","year":2021},"citing_paper":{"arxiv_id":"2506.07121","last_updated":"2026-08-01T10:21:24Z","snapshot_observed_at":"2026-08-08T16:50:44.576571Z","submitted_at":"2025-06-08T13:07:41Z","title":"Quality-Diversity Red-Teaming: Automated Generation of High-Quality and Diverse Attackers for Large Language Models","version":2},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-07T05:47:06.311055Z"},"links":{"citing_paper":"/paper/2506.07121"},"observation_digest":"sha256:941b921555629fc0cb3d60dec4910adba5c9ef0579da2278302431cc0460108f","observation_id":"d84d0101-5df3-4618-bc73-b038fcf7aa60","resolution":{"observed_at":"2026-08-07T05:47:10.483219Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2209.07858","last_updated":"2022-11-22T19:12:57Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2022-08-23T23:37:14Z","title":"Red Teaming Language Models to Reduce Harms: Methods, Scaling Behaviors, and Lessons Learned","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2209.07858","snapshot_observed_at":"2026-08-07T05:47:06.315314Z","title":"Ganguli, L","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2506.07121","last_updated":"2026-08-01T10:21:24Z","snapshot_observed_at":"2026-08-08T16:50:44.576571Z","submitted_at":"2025-06-08T13:07:41Z","title":"Quality-Diversity Red-Teaming: Automated Generation of High-Quality and Diverse Attackers for Large Language Models","version":2},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-07T05:47:06.315314Z"},"links":{"cited_paper":"/paper/2209.07858","citing_paper":"/paper/2506.07121"},"observation_digest":"sha256:f5bd4f6c491580ff17ee697397625a6807f0345fa5c98c16eb71a4088277f26c","observation_id":"530324e5-243d-475f-befc-a84336070e06","resolution":{"observed_at":"2026-08-07T05:47:06.315314Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2406.11654","last_updated":"2024-06-17T15:36:14Z","snapshot_observed_at":"2026-07-06T18:32:15.404516Z","submitted_at":"2024-06-17T15:36:14Z","title":"Ruby Teaming: Improving Quality Diversity Search with Memory for Automated Red Teaming","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2406.11654","snapshot_observed_at":"2026-08-07T05:47:06.319531Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.07121","last_updated":"2026-08-01T10:21:24Z","snapshot_observed_at":"2026-08-08T16:50:44.576571Z","submitted_at":"2025-06-08T13:07:41Z","title":"Quality-Diversity Red-Teaming: Automated Generation of High-Quality and Diverse Attackers for Large Language Models","version":2},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-07T05:47:06.319531Z"},"links":{"cited_paper":"/paper/2406.11654","citing_paper":"/paper/2506.07121"},"observation_digest":"sha256:858b371421f5873df9615e5fa80829a17a8cf494dcea07fbd99397488c1acc63","observation_id":"67abd309-4205-47e6-bbf7-6df6236cdd2e","resolution":{"observed_at":"2026-08-07T05:47:06.319531Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:47:10.265041Z","title":null,"venue":null,"work_id":"1c04f697-59ec-45ab-804b-60ff095d64d4","year":2024},"citing_paper":{"arxiv_id":"2506.07121","last_updated":"2026-08-01T10:21:24Z","snapshot_observed_at":"2026-08-08T16:50:44.576571Z","submitted_at":"2025-06-08T13:07:41Z","title":"Quality-Diversity Red-Teaming: Automated Generation of High-Quality and Diverse Attackers for Large Language Models","version":2},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-07T05:47:06.323525Z"},"links":{"citing_paper":"/paper/2506.07121"},"observation_digest":"sha256:d97e6c00a25e36e414712acd70fad626664c60db6274a118a881d378cbf45fa4","observation_id":"e8e1e330-dff1-4996-84b0-4a610fefe98f","resolution":{"observed_at":"2026-08-07T05:47:10.337393Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:47:10.108751Z","title":"Hughes, M","venue":null,"work_id":"ad5e4c99-7747-4534-b3c6-f313218bfd56","year":2024},"citing_paper":{"arxiv_id":"2506.07121","last_updated":"2026-08-01T10:21:24Z","snapshot_observed_at":"2026-08-08T16:50:44.576571Z","submitted_at":"2025-06-08T13:07:41Z","title":"Quality-Diversity Red-Teaming: Automated Generation of High-Quality and Diverse Attackers for Large Language Models","version":2},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-07T05:47:06.327536Z"},"links":{"citing_paper":"/paper/2506.07121"},"observation_digest":"sha256:fa735893a960562e40a84fabbca22a4b20c912428551653f52269ff4fb65036e","observation_id":"69f05169-049c-45a3-aa90-a5357d94ac72","resolution":{"observed_at":"2026-08-07T05:47:10.187505Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2312.06674","last_updated":"2023-12-07T19:40:50Z","snapshot_observed_at":"2026-07-06T17:00:00.321552Z","submitted_at":"2023-12-07T19:40:50Z","title":"Llama Guard: LLM-based Input-Output Safeguard for Human-AI Conversations","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2312.06674","snapshot_observed_at":"2026-08-07T05:47:06.331292Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.07121","last_updated":"2026-08-01T10:21:24Z","snapshot_observed_at":"2026-08-08T16:50:44.576571Z","submitted_at":"2025-06-08T13:07:41Z","title":"Quality-Diversity Red-Teaming: Automated Generation of High-Quality and Diverse Attackers for Large Language Models","version":2},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-07T05:47:06.331292Z"},"links":{"cited_paper":"/paper/2312.06674","citing_paper":"/paper/2506.07121"},"observation_digest":"sha256:d9ca4a6094087ae3fca1f2596586dd8b9cc080bb1e86e922e3f41a8dbdded279","observation_id":"ff8c9001-6c80-4574-b97e-7e4483d26373","resolution":{"observed_at":"2026-08-07T05:47:06.331292Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:47:09.977959Z","title":"Kumar, A","venue":null,"work_id":"ff43100d-f89c-4211-a074-b765f6f18b26","year":2020},"citing_paper":{"arxiv_id":"2506.07121","last_updated":"2026-08-01T10:21:24Z","snapshot_observed_at":"2026-08-08T16:50:44.576571Z","submitted_at":"2025-06-08T13:07:41Z","title":"Quality-Diversity Red-Teaming: Automated Generation of High-Quality and Diverse Attackers for Large Language Models","version":2},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-07T05:47:06.335521Z"},"links":{"citing_paper":"/paper/2506.07121"},"observation_digest":"sha256:8847c043e1a1d14e79ed29aeb9bf011d2d44bfd6eff7d97f43e56d62ab176dee","observation_id":"d8e680d1-4ce1-468d-b82e-3c41893cc558","resolution":{"observed_at":"2026-08-07T05:47:10.057237Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2305.17444","last_updated":"2023-05-27T11:00:15Z","snapshot_observed_at":"2026-08-04T18:01:36.540422Z","submitted_at":"2023-05-27T11:00:15Z","title":"Query-Efficient Black-Box Red Teaming via Bayesian Optimization","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2305.17444","snapshot_observed_at":"2026-08-07T05:47:06.339321Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.07121","last_updated":"2026-08-01T10:21:24Z","snapshot_observed_at":"2026-08-08T16:50:44.576571Z","submitted_at":"2025-06-08T13:07:41Z","title":"Quality-Diversity Red-Teaming: Automated Generation of High-Quality and Diverse Attackers for Large Language Models","version":2},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-07T05:47:06.339321Z"},"links":{"cited_paper":"/paper/2305.17444","citing_paper":"/paper/2506.07121"},"observation_digest":"sha256:bf224501c59f43137b40ddcb4b74a68523de05448e210dd564d80642b3eebee4","observation_id":"ed031ec8-5f5e-4a6c-ae71-2b8dc591856c","resolution":{"observed_at":"2026-08-07T05:47:06.339321Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:47:09.842000Z","title":null,"venue":null,"work_id":"3f1ed44c-c534-4b3d-aa36-db4c43c7d53c","year":2025},"citing_paper":{"arxiv_id":"2506.07121","last_updated":"2026-08-01T10:21:24Z","snapshot_observed_at":"2026-08-08T16:50:44.576571Z","submitted_at":"2025-06-08T13:07:41Z","title":"Quality-Diversity Red-Teaming: Automated Generation of High-Quality and Diverse Attackers for Large Language Models","version":2},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-07T05:47:06.343332Z"},"links":{"citing_paper":"/paper/2506.07121"},"observation_digest":"sha256:0980b15e9da4d4399ccea2872e042260a86efea51164c859abd0ae45ac036a24","observation_id":"368b3530-a080-421b-973c-f6a3a13ebf21","resolution":{"observed_at":"2026-08-07T05:47:09.921799Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:47:09.657088Z","title":"Lehman and K","venue":null,"work_id":"38637f43-0f80-4d1e-bcf0-c7c73ee0a7d8","year":2011},"citing_paper":{"arxiv_id":"2506.07121","last_updated":"2026-08-01T10:21:24Z","snapshot_observed_at":"2026-08-08T16:50:44.576571Z","submitted_at":"2025-06-08T13:07:41Z","title":"Quality-Diversity Red-Teaming: Automated Generation of High-Quality and Diverse Attackers for Large Language Models","version":2},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-08-07T05:47:06.347223Z"},"links":{"citing_paper":"/paper/2506.07121"},"observation_digest":"sha256:b026cf6de9af274e9d4005e51629aa0b1e2cffdd8100780434bebd6c3e3f3bb3","observation_id":"55b360fb-1dc4-4a5a-b6d5-97abf34106d2","resolution":{"observed_at":"2026-08-07T05:47:09.753027Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:47:09.507300Z","title":null,"venue":null,"work_id":"a1f7cccb-03cb-4136-932f-46153104137d","year":2025},"citing_paper":{"arxiv_id":"2506.07121","last_updated":"2026-08-01T10:21:24Z","snapshot_observed_at":"2026-08-08T16:50:44.576571Z","submitted_at":"2025-06-08T13:07:41Z","title":"Quality-Diversity Red-Teaming: Automated Generation of High-Quality and Diverse Attackers for Large Language Models","version":2},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-08-07T05:47:06.351079Z"},"links":{"citing_paper":"/paper/2506.07121"},"observation_digest":"sha256:105397bea624141e16b131d3b1f53d8e20bfe8b4e143642390133b0df03c2bf7","observation_id":"0e16e9b9-30c1-4e9d-8bb6-84233b388f8a","resolution":{"observed_at":"2026-08-07T05:47:09.561224Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:47:09.339627Z","title":null,"venue":null,"work_id":"f94231df-7dcd-4e1e-9901-53cad8c8a664","year":2024},"citing_paper":{"arxiv_id":"2506.07121","last_updated":"2026-08-01T10:21:24Z","snapshot_observed_at":"2026-08-08T16:50:44.576571Z","submitted_at":"2025-06-08T13:07:41Z","title":"Quality-Diversity Red-Teaming: Automated Generation of High-Quality and Diverse Attackers for Large Language Models","version":2},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-08-07T05:47:06.354960Z"},"links":{"citing_paper":"/paper/2506.07121"},"observation_digest":"sha256:8502335256d3fbec80d19b66fb8425f803b87a1e537132fe11f83f19cd61d9fd","observation_id":"488a8623-4496-4674-bcc3-be9a4e926901","resolution":{"observed_at":"2026-08-07T05:47:09.422246Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:47:09.098810Z","title":null,"venue":null,"work_id":"f0760e39-98b4-4d10-976b-a84c4e32e9ac","year":2025},"citing_paper":{"arxiv_id":"2506.07121","last_updated":"2026-08-01T10:21:24Z","snapshot_observed_at":"2026-08-08T16:50:44.576571Z","submitted_at":"2025-06-08T13:07:41Z","title":"Quality-Diversity Red-Teaming: Automated Generation of High-Quality and Diverse Attackers for Large Language Models","version":2},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-08-07T05:47:06.358905Z"},"links":{"citing_paper":"/paper/2506.07121"},"observation_digest":"sha256:47fda41f6b862b258b66ef17b6a13bb88c657fa2c15ae304707e1349f34baec1","observation_id":"f7aba010-979d-48e2-b4b0-bebcb28285a6","resolution":{"observed_at":"2026-08-07T05:47:09.189626Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2410.05295","last_updated":"2025-04-22T05:20:39Z","snapshot_observed_at":"2026-07-06T19:29:14.335016Z","submitted_at":"2024-10-03T17:59:01Z","title":"AutoDAN-Turbo: A Lifelong Agent for Strategy Self-Exploration to Jailbreak LLMs","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2410.05295","snapshot_observed_at":"2026-08-07T05:47:06.362862Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.07121","last_updated":"2026-08-01T10:21:24Z","snapshot_observed_at":"2026-08-08T16:50:44.576571Z","submitted_at":"2025-06-08T13:07:41Z","title":"Quality-Diversity Red-Teaming: Automated Generation of High-Quality and Diverse Attackers for Large Language Models","version":2},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-08-07T05:47:06.362862Z"},"links":{"cited_paper":"/paper/2410.05295","citing_paper":"/paper/2506.07121"},"observation_digest":"sha256:249ab8cbbe1784f681864b823b23fa8a1858245d4555bc17ea67e0488a9d5fc6","observation_id":"04f9bc7a-20fe-4c09-bab5-2efced5b5b29","resolution":{"observed_at":"2026-08-07T05:47:06.362862Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2501.01830","last_updated":"2025-01-03T14:30:14Z","snapshot_observed_at":"2026-08-03T11:54:32.402984Z","submitted_at":"2025-01-03T14:30:14Z","title":"Auto-RT: Automatic Jailbreak Strategy Exploration for Red-Teaming Large Language Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2501.01830","snapshot_observed_at":"2026-08-07T05:47:06.366957Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2506.07121","last_updated":"2026-08-01T10:21:24Z","snapshot_observed_at":"2026-08-08T16:50:44.576571Z","submitted_at":"2025-06-08T13:07:41Z","title":"Quality-Diversity Red-Teaming: Automated Generation of High-Quality and Diverse Attackers for Large Language Models","version":2},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-08-07T05:47:06.366957Z"},"links":{"cited_paper":"/paper/2501.01830","citing_paper":"/paper/2506.07121"},"observation_digest":"sha256:31f96115483d3fd279f7febc845cd618f6f4abca74813ceb04e70b6edf30129f","observation_id":"c72098f9-5c78-41b4-9fcf-a7936fadf178","resolution":{"observed_at":"2026-08-07T05:47:06.366957Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:47:08.977717Z","title":null,"venue":null,"work_id":"316de84f-d259-477c-b3f2-15a4fe7823c7","year":2022},"citing_paper":{"arxiv_id":"2506.07121","last_updated":"2026-08-01T10:21:24Z","snapshot_observed_at":"2026-08-08T16:50:44.576571Z","submitted_at":"2025-06-08T13:07:41Z","title":"Quality-Diversity Red-Teaming: Automated Generation of High-Quality and Diverse Attackers for Large Language Models","version":2},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-08-07T05:47:06.370604Z"},"links":{"citing_paper":"/paper/2506.07121"},"observation_digest":"sha256:8ddbddeaf241b4b1936b69ef8d660f33c708305a68c063ed951eacf12be48d39","observation_id":"d4cb2434-aa2d-4e28-9106-4728fbd7ac27","resolution":{"observed_at":"2026-08-07T05:47:09.066532Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1504.04909","last_updated":"2015-04-20T01:17:00Z","snapshot_observed_at":"2026-07-06T04:15:24.342522Z","submitted_at":"2015-04-20T01:17:00Z","title":"Illuminating search spaces by mapping elites","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1504.04909","snapshot_observed_at":"2026-08-07T05:47:06.374005Z","title":"Mouret and J","venue":null,"work_id":null,"year":2015},"citing_paper":{"arxiv_id":"2506.07121","last_updated":"2026-08-01T10:21:24Z","snapshot_observed_at":"2026-08-08T16:50:44.576571Z","submitted_at":"2025-06-08T13:07:41Z","title":"Quality-Diversity Red-Teaming: Automated Generation of High-Quality and Diverse Attackers for Large Language Models","version":2},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-08-07T05:47:06.374005Z"},"links":{"cited_paper":"/paper/1504.04909","citing_paper":"/paper/2506.07121"},"observation_digest":"sha256:c267466cc7a9401517e83efd82a87f6ff9240786594dab43faddcd4a8f3be938","observation_id":"7cb49e18-6e4a-4b11-9cf0-c643e13bfec0","resolution":{"observed_at":"2026-08-07T05:47:06.374005Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2303.08774","last_updated":"2024-03-04T06:01:33Z","snapshot_observed_at":"2026-08-07T07:30:12.213965Z","submitted_at":"2023-03-15T17:15:04Z","title":"GPT-4 Technical Report","version":6},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2303.08774","snapshot_observed_at":"2026-08-07T05:47:06.378195Z","title":"Achiam, S","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.07121","last_updated":"2026-08-01T10:21:24Z","snapshot_observed_at":"2026-08-08T16:50:44.576571Z","submitted_at":"2025-06-08T13:07:41Z","title":"Quality-Diversity Red-Teaming: Automated Generation of High-Quality and Diverse Attackers for Large Language Models","version":2},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-08-07T05:47:06.378195Z"},"links":{"cited_paper":"/paper/2303.08774","citing_paper":"/paper/2506.07121"},"observation_digest":"sha256:71d15d7d6e4222c609d7218da2340fcaf011ad07fff339482d4f5bbfde3dfc04","observation_id":"d976701a-ec82-472e-a490-91d55c6aa501","resolution":{"observed_at":"2026-08-07T05:47:06.378195Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:47:08.866848Z","title":"Ouyang, J","venue":null,"work_id":"584adf95-624b-4879-be63-646ffba19b84","year":2022},"citing_paper":{"arxiv_id":"2506.07121","last_updated":"2026-08-01T10:21:24Z","snapshot_observed_at":"2026-08-08T16:50:44.576571Z","submitted_at":"2025-06-08T13:07:41Z","title":"Quality-Diversity Red-Teaming: Automated Generation of High-Quality and Diverse Attackers for Large Language Models","version":2},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-08-07T05:47:06.381808Z"},"links":{"citing_paper":"/paper/2506.07121"},"observation_digest":"sha256:2b69abfd0170488ec0cac1f26f1a6ffa850698836028d7e288dbb18dc940472e","observation_id":"da3ece7e-93ee-461a-82f1-c75409396c59","resolution":{"observed_at":"2026-08-07T05:47:08.909815Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2408.10701","last_updated":"2024-08-20T09:58:01Z","snapshot_observed_at":"2026-07-06T19:03:22.586506Z","submitted_at":"2024-08-20T09:58:01Z","title":"Ferret: Faster and Effective Automated Red Teaming with Reward-Based Scoring Technique","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2408.10701","snapshot_observed_at":"2026-08-07T05:47:06.385682Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.07121","last_updated":"2026-08-01T10:21:24Z","snapshot_observed_at":"2026-08-08T16:50:44.576571Z","submitted_at":"2025-06-08T13:07:41Z","title":"Quality-Diversity Red-Teaming: Automated Generation of High-Quality and Diverse Attackers for Large Language Models","version":2},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-08-07T05:47:06.385682Z"},"links":{"cited_paper":"/paper/2408.10701","citing_paper":"/paper/2506.07121"},"observation_digest":"sha256:90466c1dfb340e4ee7743abf6e2894bba956258b719e672aced5756bcbe9cf61","observation_id":"557819b9-5963-4546-9936-3f57596b3bf7","resolution":{"observed_at":"2026-08-07T05:47:06.385682Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:47:08.680903Z","title":"Papineni, S","venue":null,"work_id":"52784b74-0465-4938-b4c8-44c22775b56b","year":2002},"citing_paper":{"arxiv_id":"2506.07121","last_updated":"2026-08-01T10:21:24Z","snapshot_observed_at":"2026-08-08T16:50:44.576571Z","submitted_at":"2025-06-08T13:07:41Z","title":"Quality-Diversity Red-Teaming: Automated Generation of High-Quality and Diverse Attackers for Large Language Models","version":2},"reference_index":36,"source":"pdf_text","source_observed_at":"2026-08-07T05:47:06.390076Z"},"links":{"citing_paper":"/paper/2506.07121"},"observation_digest":"sha256:79f5b091b11177fa536e79648fecd34ea6cdf9e87e20a2c03c2d08bd7c6e09db","observation_id":"b5577420-bbba-4584-bd19-2040614556f2","resolution":{"observed_at":"2026-08-07T05:47:08.749818Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2410.01606","last_updated":"2024-10-02T14:47:05Z","snapshot_observed_at":"2026-08-03T19:54:21.584740Z","submitted_at":"2024-10-02T14:47:05Z","title":"Automated Red Teaming with GOAT: the Generative Offensive Agent Tester","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2410.01606","snapshot_observed_at":"2026-08-07T05:47:06.393841Z","title":"Pavlova, E","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2506.07121","last_updated":"2026-08-01T10:21:24Z","snapshot_observed_at":"2026-08-08T16:50:44.576571Z","submitted_at":"2025-06-08T13:07:41Z","title":"Quality-Diversity Red-Teaming: Automated Generation of High-Quality and Diverse Attackers for Large Language Models","version":2},"reference_index":37,"source":"pdf_text","source_observed_at":"2026-08-07T05:47:06.393841Z"},"links":{"cited_paper":"/paper/2410.01606","citing_paper":"/paper/2506.07121"},"observation_digest":"sha256:14d6b0f352a0a93d0e047fbf905b9ad8aad81d24e5f90ea95c3b5e59f467fcc6","observation_id":"a3ccd036-9131-4919-a898-91b51e385d9a","resolution":{"observed_at":"2026-08-07T05:47:06.393841Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:47:08.555151Z","title":"Perez, S","venue":null,"work_id":"d6502c52-3911-4e66-b138-dcddd0999b7d","year":2022},"citing_paper":{"arxiv_id":"2506.07121","last_updated":"2026-08-01T10:21:24Z","snapshot_observed_at":"2026-08-08T16:50:44.576571Z","submitted_at":"2025-06-08T13:07:41Z","title":"Quality-Diversity Red-Teaming: Automated Generation of High-Quality and Diverse Attackers for Large Language Models","version":2},"reference_index":38,"source":"pdf_text","source_observed_at":"2026-08-07T05:47:06.398370Z"},"links":{"citing_paper":"/paper/2506.07121"},"observation_digest":"sha256:1396d4c56aa704ad80ea7c19df45f15ebbc1e57048b9ca70211fa7b2863a1fcf","observation_id":"db8f2b4a-8f03-4df1-b33e-e7dcaf7024d8","resolution":{"observed_at":"2026-08-07T05:47:08.595811Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:47:08.414283Z","title":"Pierrot and A","venue":null,"work_id":"f262dee5-7ad9-4112-8a3b-e4cd9f662dbe","year":2023},"citing_paper":{"arxiv_id":"2506.07121","last_updated":"2026-08-01T10:21:24Z","snapshot_observed_at":"2026-08-08T16:50:44.576571Z","submitted_at":"2025-06-08T13:07:41Z","title":"Quality-Diversity Red-Teaming: Automated Generation of High-Quality and Diverse Attackers for Large Language Models","version":2},"reference_index":39,"source":"pdf_text","source_observed_at":"2026-08-07T05:47:06.402412Z"},"links":{"citing_paper":"/paper/2506.07121"},"observation_digest":"sha256:91bb6b21b5d853d07eb27ee1a0a2d22589e5b64f8f7ddf10bead3fe3f5b097fe","observation_id":"79e32fbf-0d62-4208-9e5f-347d2531b2d5","resolution":{"observed_at":"2026-08-07T05:47:08.455692Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:47:06.405858Z","title":"Radford, J","venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2506.07121","last_updated":"2026-08-01T10:21:24Z","snapshot_observed_at":"2026-08-08T16:50:44.576571Z","submitted_at":"2025-06-08T13:07:41Z","title":"Quality-Diversity Red-Teaming: Automated Generation of High-Quality and Diverse Attackers for Large Language Models","version":2},"reference_index":40,"source":"pdf_text","source_observed_at":"2026-08-07T05:47:06.405858Z"},"links":{"citing_paper":"/paper/2506.07121"},"observation_digest":"sha256:1c08df9b3427d14a51d3686e549121e0d0bcb6bb843e19bb6cde4b2f2bc38a5e","observation_id":"f31cb81d-0f12-40b3-95da-a498447ae0a3","resolution":{"observed_at":"2026-08-07T05:47:06.405858Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2402.16822","last_updated":"2024-12-11T18:07:25Z","snapshot_observed_at":"2026-08-08T15:50:09.401813Z","submitted_at":"2024-02-26T18:47:27Z","title":"Rainbow Teaming: Open-Ended Generation of Diverse Adversarial Prompts","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.16822","snapshot_observed_at":"2026-08-07T05:47:06.411541Z","title":"Samvelyan, S","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.07121","last_updated":"2026-08-01T10:21:24Z","snapshot_observed_at":"2026-08-08T16:50:44.576571Z","submitted_at":"2025-06-08T13:07:41Z","title":"Quality-Diversity Red-Teaming: Automated Generation of High-Quality and Diverse Attackers for Large Language Models","version":2},"reference_index":41,"source":"pdf_text","source_observed_at":"2026-08-07T05:47:06.411541Z"},"links":{"cited_paper":"/paper/2402.16822","citing_paper":"/paper/2506.07121"},"observation_digest":"sha256:2d61cd187f17d82c550e7fc0ba558ab37e846d0befad756dd14d015dd785aaf4","observation_id":"218d1088-3bf5-40a8-8729-f2bc379ba839","resolution":{"observed_at":"2026-08-07T05:47:06.411541Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1707.06347","last_updated":"2017-08-28T09:20:06Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2017-07-20T02:32:33Z","title":"Proximal Policy Optimization Algorithms","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1707.06347","snapshot_observed_at":"2026-08-07T05:47:06.424963Z","title":"Schulman, F","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2506.07121","last_updated":"2026-08-01T10:21:24Z","snapshot_observed_at":"2026-08-08T16:50:44.576571Z","submitted_at":"2025-06-08T13:07:41Z","title":"Quality-Diversity Red-Teaming: Automated Generation of High-Quality and Diverse Attackers for Large Language Models","version":2},"reference_index":42,"source":"pdf_text","source_observed_at":"2026-08-07T05:47:06.424963Z"},"links":{"cited_paper":"/paper/1707.06347","citing_paper":"/paper/2506.07121"},"observation_digest":"sha256:b5c7bcdabd4601db26003f7b570bda5e0fd558d2762b6a02030146a45f0f42b6","observation_id":"8fd6be47-9214-47cc-ba8d-bbc49e7eee8e","resolution":{"observed_at":"2026-08-07T05:47:06.424963Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2402.03300","last_updated":"2024-04-27T15:25:53Z","snapshot_observed_at":"2026-08-06T14:58:42.911363Z","submitted_at":"2024-02-05T18:55:32Z","title":"DeepSeekMath: Pushing the Limits of Mathematical Reasoning in Open Language Models","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.03300","snapshot_observed_at":"2026-08-07T05:47:06.433915Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.07121","last_updated":"2026-08-01T10:21:24Z","snapshot_observed_at":"2026-08-08T16:50:44.576571Z","submitted_at":"2025-06-08T13:07:41Z","title":"Quality-Diversity Red-Teaming: Automated Generation of High-Quality and Diverse Attackers for Large Language Models","version":2},"reference_index":43,"source":"pdf_text","source_observed_at":"2026-08-07T05:47:06.433915Z"},"links":{"cited_paper":"/paper/2402.03300","citing_paper":"/paper/2506.07121"},"observation_digest":"sha256:83f185ac88c1727f6cfacd9f870bc8da8ecf28bf252088b727e2a0d4ec0fb2d0","observation_id":"aa003bf7-7c74-4f60-ac57-1a6d6c191ee5","resolution":{"observed_at":"2026-08-07T05:47:06.433915Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:47:08.258331Z","title":"do anything now","venue":null,"work_id":"948390cb-613f-4b50-937a-0993075e2dea","year":2024},"citing_paper":{"arxiv_id":"2506.07121","last_updated":"2026-08-01T10:21:24Z","snapshot_observed_at":"2026-08-08T16:50:44.576571Z","submitted_at":"2025-06-08T13:07:41Z","title":"Quality-Diversity Red-Teaming: Automated Generation of High-Quality and Diverse Attackers for Large Language Models","version":2},"reference_index":44,"source":"pdf_text","source_observed_at":"2026-08-07T05:47:06.443379Z"},"links":{"citing_paper":"/paper/2506.07121"},"observation_digest":"sha256:4293882c40ecb07678b7541ec03d80e022376eec8b469ad84974d7c79e5fc06f","observation_id":"e1aa7f07-83e0-4968-be05-3ce270093c46","resolution":{"observed_at":"2026-08-07T05:47:08.304003Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:47:08.091725Z","title":null,"venue":null,"work_id":"547e81cd-40f3-4be5-aace-7ab561691879","year":2024},"citing_paper":{"arxiv_id":"2506.07121","last_updated":"2026-08-01T10:21:24Z","snapshot_observed_at":"2026-08-08T16:50:44.576571Z","submitted_at":"2025-06-08T13:07:41Z","title":"Quality-Diversity Red-Teaming: Automated Generation of High-Quality and Diverse Attackers for Large Language Models","version":2},"reference_index":45,"source":"pdf_text","source_observed_at":"2026-08-07T05:47:06.450960Z"},"links":{"citing_paper":"/paper/2506.07121"},"observation_digest":"sha256:13cd7b5974c6448c67de0efaaa57ccdbc5cf5f53281ee918e7a8a64351ab40f5","observation_id":"0100c8d6-5657-42ae-b12b-32b884030d30","resolution":{"observed_at":"2026-08-07T05:47:08.193528Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2403.08295","last_updated":"2024-04-16T12:52:47Z","snapshot_observed_at":"2026-08-03T03:29:01.959523Z","submitted_at":"2024-03-13T06:59:16Z","title":"Gemma: Open Models Based on Gemini Research and Technology","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2403.08295","snapshot_observed_at":"2026-08-07T05:47:06.458934Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.07121","last_updated":"2026-08-01T10:21:24Z","snapshot_observed_at":"2026-08-08T16:50:44.576571Z","submitted_at":"2025-06-08T13:07:41Z","title":"Quality-Diversity Red-Teaming: Automated Generation of High-Quality and Diverse Attackers for Large Language Models","version":2},"reference_index":46,"source":"pdf_text","source_observed_at":"2026-08-07T05:47:06.458934Z"},"links":{"cited_paper":"/paper/2403.08295","citing_paper":"/paper/2506.07121"},"observation_digest":"sha256:a4f919efa0fa28dbbe260bbb06189d6e44c4c62d61a29a624c0348b262bb5d14","observation_id":"6a347ce3-01f3-4f55-94f3-36a0c335e24b","resolution":{"observed_at":"2026-08-07T05:47:06.458934Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:47:07.933740Z","title":"Tjanaka, M","venue":null,"work_id":"944760b9-dc68-4e46-9c96-798b7f136b4c","year":2021},"citing_paper":{"arxiv_id":"2506.07121","last_updated":"2026-08-01T10:21:24Z","snapshot_observed_at":"2026-08-08T16:50:44.576571Z","submitted_at":"2025-06-08T13:07:41Z","title":"Quality-Diversity Red-Teaming: Automated Generation of High-Quality and Diverse Attackers for Large Language Models","version":2},"reference_index":47,"source":"pdf_text","source_observed_at":"2026-08-07T05:47:06.468221Z"},"links":{"citing_paper":"/paper/2506.07121"},"observation_digest":"sha256:7b358ffcc56e6396341676ae608dc73eb86eaf143a152b449f8227651b40e558","observation_id":"2cafc167-6944-42ee-90f1-3ff624017879","resolution":{"observed_at":"2026-08-07T05:47:08.037276Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:47:07.791136Z","title":"Tylkin, G","venue":null,"work_id":"f8b030f5-3a11-4167-83cc-d3ff1993e657","year":2021},"citing_paper":{"arxiv_id":"2506.07121","last_updated":"2026-08-01T10:21:24Z","snapshot_observed_at":"2026-08-08T16:50:44.576571Z","submitted_at":"2025-06-08T13:07:41Z","title":"Quality-Diversity Red-Teaming: Automated Generation of High-Quality and Diverse Attackers for Large Language Models","version":2},"reference_index":48,"source":"pdf_text","source_observed_at":"2026-08-07T05:47:06.477058Z"},"links":{"citing_paper":"/paper/2506.07121"},"observation_digest":"sha256:085fa023e45ddcbeeeb5ba376cf58882fcf22a56943272536227e614157a16bf","observation_id":"f2678370-4881-4a30-891d-7edee253b3d9","resolution":{"observed_at":"2026-08-07T05:47:07.862758Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2504.15585","last_updated":"2025-06-09T02:36:20Z","snapshot_observed_at":"2026-08-09T14:46:30.842437Z","submitted_at":"2025-04-22T05:02:49Z","title":"A Comprehensive Survey in LLM(-Agent) Full Stack Safety: Data, Training and Deployment","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2504.15585","snapshot_observed_at":"2026-08-07T05:47:06.486187Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2506.07121","last_updated":"2026-08-01T10:21:24Z","snapshot_observed_at":"2026-08-08T16:50:44.576571Z","submitted_at":"2025-06-08T13:07:41Z","title":"Quality-Diversity Red-Teaming: Automated Generation of High-Quality and Diverse Attackers for Large Language Models","version":2},"reference_index":49,"source":"pdf_text","source_observed_at":"2026-08-07T05:47:06.486187Z"},"links":{"cited_paper":"/paper/2504.15585","citing_paper":"/paper/2506.07121"},"observation_digest":"sha256:ce57df9390fc221123b948201bc5c729cddb7142158a793bfba020ddb1e6b0d3","observation_id":"17b4c414-b8f2-4f89-9b36-58b936c31ebc","resolution":{"observed_at":"2026-08-07T05:47:06.486187Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:47:07.644758Z","title":null,"venue":null,"work_id":"d7933c71-b833-4914-94b8-90f2ea23fe86","year":2023},"citing_paper":{"arxiv_id":"2506.07121","last_updated":"2026-08-01T10:21:24Z","snapshot_observed_at":"2026-08-08T16:50:44.576571Z","submitted_at":"2025-06-08T13:07:41Z","title":"Quality-Diversity Red-Teaming: Automated Generation of High-Quality and Diverse Attackers for Large Language Models","version":2},"reference_index":50,"source":"pdf_text","source_observed_at":"2026-08-07T05:47:06.495349Z"},"links":{"citing_paper":"/paper/2506.07121"},"observation_digest":"sha256:3384b1715c972ca4218a1a0c8a594b0c7a519a612f26bd2b46e33f28a5175e10","observation_id":"6ec8586b-9385-4b74-aa5d-c511cf6c4497","resolution":{"observed_at":"2026-08-07T05:47:07.714583Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2402.13457","last_updated":"2024-05-17T05:00:24Z","snapshot_observed_at":"2026-07-06T17:33:08.817655Z","submitted_at":"2024-02-21T01:26:39Z","title":"A Comprehensive Study of Jailbreak Attack versus Defense for Large Language Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.13457","snapshot_observed_at":"2026-08-07T05:47:06.503637Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.07121","last_updated":"2026-08-01T10:21:24Z","snapshot_observed_at":"2026-08-08T16:50:44.576571Z","submitted_at":"2025-06-08T13:07:41Z","title":"Quality-Diversity Red-Teaming: Automated Generation of High-Quality and Diverse Attackers for Large Language Models","version":2},"reference_index":51,"source":"pdf_text","source_observed_at":"2026-08-07T05:47:06.503637Z"},"links":{"cited_paper":"/paper/2402.13457","citing_paper":"/paper/2506.07121"},"observation_digest":"sha256:6e277d6ca924fe99c5573d0e615b19d28808de3a4707259f81fb1ce1d49e3c83","observation_id":"4ec1c18d-206d-45a6-ad1b-233c7e70c5d4","resolution":{"observed_at":"2026-08-07T05:47:06.503637Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2412.15115","last_updated":"2025-01-03T02:18:21Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-12-19T17:56:09Z","title":"Qwen2.5 Technical Report","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2412.15115","snapshot_observed_at":"2026-08-07T05:47:06.512232Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.07121","last_updated":"2026-08-01T10:21:24Z","snapshot_observed_at":"2026-08-08T16:50:44.576571Z","submitted_at":"2025-06-08T13:07:41Z","title":"Quality-Diversity Red-Teaming: Automated Generation of High-Quality and Diverse Attackers for Large Language Models","version":2},"reference_index":52,"source":"pdf_text","source_observed_at":"2026-08-07T05:47:06.512232Z"},"links":{"cited_paper":"/paper/2412.15115","citing_paper":"/paper/2506.07121"},"observation_digest":"sha256:097d9733e21143f992f8f4aada42cfa12bb4ea012e6a2557755dfeb24a9e0f78","observation_id":"c381b726-213a-42a9-be42-bf64e4373be7","resolution":{"observed_at":"2026-08-07T05:47:06.512232Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2407.04295","last_updated":"2024-08-30T11:57:47Z","snapshot_observed_at":"2026-08-04T23:34:13.332065Z","submitted_at":"2024-07-05T06:57:30Z","title":"Jailbreak Attacks and Defenses Against Large Language Models: A Survey","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2407.04295","snapshot_observed_at":"2026-08-07T05:47:06.519986Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.07121","last_updated":"2026-08-01T10:21:24Z","snapshot_observed_at":"2026-08-08T16:50:44.576571Z","submitted_at":"2025-06-08T13:07:41Z","title":"Quality-Diversity Red-Teaming: Automated Generation of High-Quality and Diverse Attackers for Large Language Models","version":2},"reference_index":53,"source":"pdf_text","source_observed_at":"2026-08-07T05:47:06.519986Z"},"links":{"cited_paper":"/paper/2407.04295","citing_paper":"/paper/2506.07121"},"observation_digest":"sha256:a549f96885578f309ccb6898fe480e9dbcbe08c9d2bbec2be05bc41c718f5a49","observation_id":"44872646-10ab-4b21-9d3f-d600164ae6ac","resolution":{"observed_at":"2026-08-07T05:47:06.519986Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:47:07.461022Z","title":"Zhang, M","venue":null,"work_id":"6c55efad-379e-4250-b096-bc20a0c9f43f","year":2023},"citing_paper":{"arxiv_id":"2506.07121","last_updated":"2026-08-01T10:21:24Z","snapshot_observed_at":"2026-08-08T16:50:44.576571Z","submitted_at":"2025-06-08T13:07:41Z","title":"Quality-Diversity Red-Teaming: Automated Generation of High-Quality and Diverse Attackers for Large Language Models","version":2},"reference_index":54,"source":"pdf_text","source_observed_at":"2026-08-07T05:47:06.527429Z"},"links":{"citing_paper":"/paper/2506.07121"},"observation_digest":"sha256:37d5b4ee44d2d94977a4b73e7b3da4ea2a1cf5e90dd89b3eb6226dfae43fbd31","observation_id":"97c1b789-3bbd-4074-8f5e-acaa3d9a555c","resolution":{"observed_at":"2026-08-07T05:47:07.527212Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:47:07.229799Z","title":null,"venue":null,"work_id":"8be038fd-e64d-4c0a-8b8f-5c09105351b1","year":2019},"citing_paper":{"arxiv_id":"2506.07121","last_updated":"2026-08-01T10:21:24Z","snapshot_observed_at":"2026-08-08T16:50:44.576571Z","submitted_at":"2025-06-08T13:07:41Z","title":"Quality-Diversity Red-Teaming: Automated Generation of High-Quality and Diverse Attackers for Large Language Models","version":2},"reference_index":55,"source":"pdf_text","source_observed_at":"2026-08-07T05:47:06.534422Z"},"links":{"citing_paper":"/paper/2506.07121"},"observation_digest":"sha256:b0d0e982e8630eb9a214d1737e0db3171d70e9f23e4d899417c76eb95c07fd15","observation_id":"9a4fddd6-7ee6-4d2a-9fe5-9bdb2a657612","resolution":{"observed_at":"2026-08-07T05:47:07.339102Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:47:07.050360Z","title":null,"venue":null,"work_id":"fbb2478f-093f-41a9-b82b-7bcd4bbad430","year":2018},"citing_paper":{"arxiv_id":"2506.07121","last_updated":"2026-08-01T10:21:24Z","snapshot_observed_at":"2026-08-08T16:50:44.576571Z","submitted_at":"2025-06-08T13:07:41Z","title":"Quality-Diversity Red-Teaming: Automated Generation of High-Quality and Diverse Attackers for Large Language Models","version":2},"reference_index":56,"source":"pdf_text","source_observed_at":"2026-08-07T05:47:06.542929Z"},"links":{"citing_paper":"/paper/2506.07121"},"observation_digest":"sha256:ff3f64194b58b2d87950b2b65647e264028c0e7daa1fb6d5ae63e06ec7857a6e","observation_id":"4a7bd24f-b2a6-4b45-a13e-66e0446f7c67","resolution":{"observed_at":"2026-08-07T05:47:07.124321Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2307.15043","last_updated":"2023-12-20T20:48:57Z","snapshot_observed_at":"2026-07-06T15:59:23.019044Z","submitted_at":"2023-07-27T17:49:12Z","title":"Universal and Transferable Adversarial Attacks on Aligned Language Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2307.15043","snapshot_observed_at":"2026-08-07T05:47:06.550282Z","title":"Limitations","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.07121","last_updated":"2026-08-01T10:21:24Z","snapshot_observed_at":"2026-08-08T16:50:44.576571Z","submitted_at":"2025-06-08T13:07:41Z","title":"Quality-Diversity Red-Teaming: Automated Generation of High-Quality and Diverse Attackers for Large Language Models","version":2},"reference_index":57,"source":"pdf_text","source_observed_at":"2026-08-07T05:47:06.550282Z"},"links":{"cited_paper":"/paper/2307.15043","citing_paper":"/paper/2506.07121"},"observation_digest":"sha256:d0a9763f5487e0f9af6cf2f79cc27d4448d6f57a0a3e9a2ddbc878f22b972993","observation_id":"c5b5dccf-b483-434d-84e9-7e16181e91d6","resolution":{"observed_at":"2026-08-07T05:47:06.550282Z","resolver_source":null,"status":"malformed_identifier"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:47:06.884223Z","title":"revolu- tionary","venue":null,"work_id":"965fa3b8-7b35-4e21-b0e8-ee941764f766","year":2025},"citing_paper":{"arxiv_id":"2506.07121","last_updated":"2026-08-01T10:21:24Z","snapshot_observed_at":"2026-08-08T16:50:44.576571Z","submitted_at":"2025-06-08T13:07:41Z","title":"Quality-Diversity Red-Teaming: Automated Generation of High-Quality and Diverse Attackers for Large Language Models","version":2},"reference_index":58,"source":"pdf_text","source_observed_at":"2026-08-07T05:47:06.558987Z"},"links":{"citing_paper":"/paper/2506.07121"},"observation_digest":"sha256:d62ac40ad70c831d3d1fce0c7bcee90c81c98b353f392143a8e5758d7573de3f","observation_id":"69616bfa-3378-4970-bfeb-f21938809c11","resolution":{"observed_at":"2026-08-07T05:47:06.947336Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}}],"paper":{"arxiv_id":"2506.07121","last_updated":"2026-08-01T10:21:24Z","latest_version":2,"primary_category":"cs.LG","snapshot_observed_at":"2026-08-08T16:50:44.576571Z","submitted_at":"2025-06-08T13:07:41Z","title":"Quality-Diversity Red-Teaming: Automated Generation of High-Quality and Diverse Attackers for Large Language Models"},"reference_resolution":{"displayed":58,"state_counts":{"malformed_identifier":1,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":36,"verified_exact":0,"verified_fuzzy":21},"total_outbound_references":58},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"thesis":"As of 10 August 2026, this Paper Citation Record lists 58 of 58 outbound references and 2 inbound Pith citation observations for arXiv:2506.07121."}