{"as_of":"2026-08-23T16:15:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:d5dc21a9188f4521f719afc5e907ce848c669c5d1a55cbfb0bd73f4800f1dae3","coverage":[{"denominator":53,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":53,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-15T21:29:16.565174Z","state":"measured"},{"denominator":53,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":53,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-23T06:30:58.430688+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2505.09820/citation-record","integrity":"/paper/2505.09820/integrity","json":"/paper/2505.09820/citation-record.json","paper":"/paper/2505.09820"},"outbound":[{"citation":{"cited_paper":{"arxiv_id":"2103.06333","last_updated":"2021-04-10T19:48:33Z","snapshot_observed_at":"2026-08-16T18:39:47.374377Z","submitted_at":"2021-03-10T20:32:59Z","title":"Unified Pre-training for Program Understanding and Generation","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2103.06333","snapshot_observed_at":"2026-08-15T21:29:16.317104Z","title":"Unified pre-training for program understanding and generation,","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2505.09820","last_updated":"2025-05-14T21:50:46Z","snapshot_observed_at":"2026-08-17T08:41:23.776591Z","submitted_at":"2025-05-14T21:50:46Z","title":"Adversarial Attack on Large Language Models using Exponentiated Gradient Descent","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-15T21:29:16.317104Z"},"links":{"cited_paper":"/paper/2103.06333","citing_paper":"/paper/2505.09820"},"observation_digest":"sha256:7c8c49c4bc36eaa4774a09a9609571915616c8f98a6606e282597da1e933db89","observation_id":"ecfac2b9-d001-430c-80aa-1f47eb2c5117","resolution":{"observed_at":"2026-08-15T21:29:16.317104Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T21:29:16.321859Z","title":"Language mod- els are few-shot learners,","venue":null,"work_id":null,"year":1901},"citing_paper":{"arxiv_id":"2505.09820","last_updated":"2025-05-14T21:50:46Z","snapshot_observed_at":"2026-08-17T08:41:23.776591Z","submitted_at":"2025-05-14T21:50:46Z","title":"Adversarial Attack on Large Language Models using Exponentiated Gradient Descent","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-15T21:29:16.321859Z"},"links":{"citing_paper":"/paper/2505.09820"},"observation_digest":"sha256:b174003a8f78ea604129f3d6a05169639d17fb1eeaa6f29d94f631415c7bd777","observation_id":"224d9eff-28a6-4853-9cdb-f37c0d937cca","resolution":{"observed_at":"2026-08-15T21:29:16.321859Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2209.14338","last_updated":"2022-10-26T08:11:56Z","snapshot_observed_at":"2026-08-18T19:55:29.087209Z","submitted_at":"2022-09-28T18:07:02Z","title":"Who is GPT-3? An Exploration of Personality, Values and Demographics","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2209.14338","snapshot_observed_at":"2026-08-15T21:29:16.326057Z","title":"Who is gpt-3? an ex- ploration of personality, values and demographics,","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2505.09820","last_updated":"2025-05-14T21:50:46Z","snapshot_observed_at":"2026-08-17T08:41:23.776591Z","submitted_at":"2025-05-14T21:50:46Z","title":"Adversarial Attack on Large Language Models using Exponentiated Gradient Descent","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-15T21:29:16.326057Z"},"links":{"cited_paper":"/paper/2209.14338","citing_paper":"/paper/2505.09820"},"observation_digest":"sha256:ccbace5fe86ac2cd292d15f1257692855da75e92f3929cfdc77419a17d0e7ca6","observation_id":"6b344d69-fb6c-4b64-ac68-856baac636e4","resolution":{"observed_at":"2026-08-15T21:29:16.326057Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2403.03230","last_updated":"2024-11-28T08:49:00Z","snapshot_observed_at":"2026-08-18T05:21:10.107902Z","submitted_at":"2024-03-04T15:27:59Z","title":"Large language models surpass human experts in predicting neuroscience results","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2403.03230","snapshot_observed_at":"2026-08-15T21:29:16.330351Z","title":"Large language models surpass human experts in predicting neuroscience results,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.09820","last_updated":"2025-05-14T21:50:46Z","snapshot_observed_at":"2026-08-17T08:41:23.776591Z","submitted_at":"2025-05-14T21:50:46Z","title":"Adversarial Attack on Large Language Models using Exponentiated Gradient Descent","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-15T21:29:16.330351Z"},"links":{"cited_paper":"/paper/2403.03230","citing_paper":"/paper/2505.09820"},"observation_digest":"sha256:daaf5231d614978a7cfd9bcfda9359a912f71ee78765609334d4d74c2e8d7f46","observation_id":"ea3f0ac9-3db0-4b8c-8e99-4af6bf8154d7","resolution":{"observed_at":"2026-08-15T21:29:16.330351Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T21:29:17.391809Z","title":"Chatgpt and large language models in academia: opportunities and challenges,","venue":null,"work_id":"64325aa8-3a99-4d43-9f0e-1ec676be2ccc","year":2023},"citing_paper":{"arxiv_id":"2505.09820","last_updated":"2025-05-14T21:50:46Z","snapshot_observed_at":"2026-08-17T08:41:23.776591Z","submitted_at":"2025-05-14T21:50:46Z","title":"Adversarial Attack on Large Language Models using Exponentiated Gradient Descent","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-15T21:29:16.334559Z"},"links":{"citing_paper":"/paper/2505.09820"},"observation_digest":"sha256:508a657da082b3299ca689929bc2ea1fbfcf1d44fbfc3872c9fb62438abb37a5","observation_id":"395a3caf-83ec-451f-b458-6c6446f698e2","resolution":{"observed_at":"2026-08-15T21:29:17.396440Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2112.04359","last_updated":"2021-12-08T16:09:48Z","snapshot_observed_at":"2026-08-09T15:17:43.394064Z","submitted_at":"2021-12-08T16:09:48Z","title":"Ethical and social risks of harm from Language Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2112.04359","snapshot_observed_at":"2026-08-15T21:29:16.338492Z","title":"Ethical and social risks of harm from language models. arxiv,","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2505.09820","last_updated":"2025-05-14T21:50:46Z","snapshot_observed_at":"2026-08-17T08:41:23.776591Z","submitted_at":"2025-05-14T21:50:46Z","title":"Adversarial Attack on Large Language Models using Exponentiated Gradient Descent","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-15T21:29:16.338492Z"},"links":{"cited_paper":"/paper/2112.04359","citing_paper":"/paper/2505.09820"},"observation_digest":"sha256:01d0971a928f57808310cca7226b9d158febe9210b92c9611234dea6fc36568e","observation_id":"06155572-288c-4d6b-b618-4ef88c394a2f","resolution":{"observed_at":"2026-08-15T21:29:16.338492Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T21:29:17.376867Z","title":"Extracting training data from large language models,","venue":null,"work_id":"f84337ff-4e15-4cce-b97b-35a68b47271a","year":2021},"citing_paper":{"arxiv_id":"2505.09820","last_updated":"2025-05-14T21:50:46Z","snapshot_observed_at":"2026-08-17T08:41:23.776591Z","submitted_at":"2025-05-14T21:50:46Z","title":"Adversarial Attack on Large Language Models using Exponentiated Gradient Descent","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-15T21:29:16.343616Z"},"links":{"citing_paper":"/paper/2505.09820"},"observation_digest":"sha256:0ab0657e0fd38fe99510ce77047bca2bdaa4ca4b9e3bf8d11e27a5944817f7f0","observation_id":"3fdffb2c-61e4-4d2f-88a4-4530c5d0ef5f","resolution":{"observed_at":"2026-08-15T21:29:17.381661Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T21:29:16.347891Z","title":"Training language models to follow instructions with human feedback,","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2505.09820","last_updated":"2025-05-14T21:50:46Z","snapshot_observed_at":"2026-08-17T08:41:23.776591Z","submitted_at":"2025-05-14T21:50:46Z","title":"Adversarial Attack on Large Language Models using Exponentiated Gradient Descent","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-15T21:29:16.347891Z"},"links":{"citing_paper":"/paper/2505.09820"},"observation_digest":"sha256:082f0a47973b1f2e33efd90352fc96c049035b68f85c6a7ea6224986fcd2bec9","observation_id":"ade23326-426d-47ea-96a8-08fb19169b21","resolution":{"observed_at":"2026-08-15T21:29:16.347891Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T21:29:17.353598Z","title":"Pretraining language models with human preferences,","venue":null,"work_id":"91f50657-1e22-4f9d-8d79-d82a2db85293","year":2023},"citing_paper":{"arxiv_id":"2505.09820","last_updated":"2025-05-14T21:50:46Z","snapshot_observed_at":"2026-08-17T08:41:23.776591Z","submitted_at":"2025-05-14T21:50:46Z","title":"Adversarial Attack on Large Language Models using Exponentiated Gradient Descent","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-15T21:29:16.352218Z"},"links":{"citing_paper":"/paper/2505.09820"},"observation_digest":"sha256:a884fa529403df22768512f4c32af10ecff423c5d7272662b0b0bdd15fbddc86","observation_id":"4bab69ff-0aea-46ea-a11d-5f4c1cc8f16f","resolution":{"observed_at":"2026-08-15T21:29:17.358053Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2309.07124","last_updated":"2023-10-09T03:34:01Z","snapshot_observed_at":"2026-08-19T03:18:22.679345Z","submitted_at":"2023-09-13T17:59:09Z","title":"RAIN: Your Language Models Can Align Themselves without Finetuning","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2309.07124","snapshot_observed_at":"2026-08-15T21:29:16.356471Z","title":"Rain: Your lan- guage models can align themselves without finetuning,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.09820","last_updated":"2025-05-14T21:50:46Z","snapshot_observed_at":"2026-08-17T08:41:23.776591Z","submitted_at":"2025-05-14T21:50:46Z","title":"Adversarial Attack on Large Language Models using Exponentiated Gradient Descent","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-15T21:29:16.356471Z"},"links":{"cited_paper":"/paper/2309.07124","citing_paper":"/paper/2505.09820"},"observation_digest":"sha256:f799f0613a6ff2e8e331f8611891c9eeb65110aacb89a99a698b4b1006ac967b","observation_id":"bb493853-c1ab-4c47-b369-2084b2ed5838","resolution":{"observed_at":"2026-08-15T21:29:16.356471Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2307.08715","last_updated":"2023-10-25T07:30:51Z","snapshot_observed_at":"2026-08-19T11:42:57.272541Z","submitted_at":"2023-07-16T01:07:15Z","title":"MasterKey: Automated Jailbreak Across Multiple Large Language Model Chatbots","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2307.08715","snapshot_observed_at":"2026-08-15T21:29:16.361397Z","title":"Jailbreaker: Automated jailbreak across multiple large language model chatbots,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.09820","last_updated":"2025-05-14T21:50:46Z","snapshot_observed_at":"2026-08-17T08:41:23.776591Z","submitted_at":"2025-05-14T21:50:46Z","title":"Adversarial Attack on Large Language Models using Exponentiated Gradient Descent","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-15T21:29:16.361397Z"},"links":{"cited_paper":"/paper/2307.08715","citing_paper":"/paper/2505.09820"},"observation_digest":"sha256:9eb15ecfb6a7b34e8b4f48f5ed3d5c8589e96d68ee4bbc338df0ab1e99ef59e2","observation_id":"dd737c25-6545-473a-a787-3c97b810300d","resolution":{"observed_at":"2026-08-15T21:29:16.361397Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2310.08419","last_updated":"2024-07-18T18:24:57Z","snapshot_observed_at":"2026-08-16T13:08:51.920120Z","submitted_at":"2023-10-12T15:38:28Z","title":"Jailbreaking Black Box Large Language Models in Twenty Queries","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2310.08419","snapshot_observed_at":"2026-08-15T21:29:16.366235Z","title":"Jailbreaking black box large language models in twenty queries,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.09820","last_updated":"2025-05-14T21:50:46Z","snapshot_observed_at":"2026-08-17T08:41:23.776591Z","submitted_at":"2025-05-14T21:50:46Z","title":"Adversarial Attack on Large Language Models using Exponentiated Gradient Descent","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-15T21:29:16.366235Z"},"links":{"cited_paper":"/paper/2310.08419","citing_paper":"/paper/2505.09820"},"observation_digest":"sha256:21c6e4a38e943adf137539e1d53b7960c045de63aed2ec9145a9c24d36163b78","observation_id":"da1edfa5-ebac-49a4-8dac-588f4095140f","resolution":{"observed_at":"2026-08-15T21:29:16.366235Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1312.6199","last_updated":"2014-02-19T16:33:14Z","snapshot_observed_at":"2026-08-15T16:41:15.505782Z","submitted_at":"2013-12-21T03:36:08Z","title":"Intriguing properties of neural networks","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1312.6199","snapshot_observed_at":"2026-08-15T21:29:16.370977Z","title":"Intriguing properties of neural networks,","venue":null,"work_id":null,"year":2013},"citing_paper":{"arxiv_id":"2505.09820","last_updated":"2025-05-14T21:50:46Z","snapshot_observed_at":"2026-08-17T08:41:23.776591Z","submitted_at":"2025-05-14T21:50:46Z","title":"Adversarial Attack on Large Language Models using Exponentiated Gradient Descent","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-15T21:29:16.370977Z"},"links":{"cited_paper":"/paper/1312.6199","citing_paper":"/paper/2505.09820"},"observation_digest":"sha256:04da37fd0e70803d078032e63c1ce047d834cb1026efa29510fe62e7a0c8c6c6","observation_id":"92200545-6874-49d2-9dc1-2d296e23ed14","resolution":{"observed_at":"2026-08-15T21:29:16.370977Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1412.6572","last_updated":"2015-03-20T20:19:16Z","snapshot_observed_at":"2026-08-19T07:17:20.004918Z","submitted_at":"2014-12-20T01:17:12Z","title":"Explaining and Harnessing Adversarial Examples","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1412.6572","snapshot_observed_at":"2026-08-15T21:29:16.375661Z","title":"Explaining and harnessing adversarial examples,","venue":null,"work_id":null,"year":2014},"citing_paper":{"arxiv_id":"2505.09820","last_updated":"2025-05-14T21:50:46Z","snapshot_observed_at":"2026-08-17T08:41:23.776591Z","submitted_at":"2025-05-14T21:50:46Z","title":"Adversarial Attack on Large Language Models using Exponentiated Gradient Descent","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-15T21:29:16.375661Z"},"links":{"cited_paper":"/paper/1412.6572","citing_paper":"/paper/2505.09820"},"observation_digest":"sha256:248ed62285a2f486434b664d4c01efd41b4ba14e6564b9a58b9dec7eab9dfba0","observation_id":"d7a49216-f850-413b-9f8d-660bb3b0ae02","resolution":{"observed_at":"2026-08-15T21:29:16.375661Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T21:29:16.379883Z","title":"Jailbroken: How does llm safety training fail?","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.09820","last_updated":"2025-05-14T21:50:46Z","snapshot_observed_at":"2026-08-17T08:41:23.776591Z","submitted_at":"2025-05-14T21:50:46Z","title":"Adversarial Attack on Large Language Models using Exponentiated Gradient Descent","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-15T21:29:16.379883Z"},"links":{"citing_paper":"/paper/2505.09820"},"observation_digest":"sha256:f7b48f74d99ee73df272492e2ae49a22d36528c12b3082e25e88f023a97533c1","observation_id":"61eb4008-ecbc-4d42-8f19-1de8b84833a0","resolution":{"observed_at":"2026-08-15T21:29:16.379883Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T21:29:16.383905Z","title":"Prompt engineering in large language models,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.09820","last_updated":"2025-05-14T21:50:46Z","snapshot_observed_at":"2026-08-17T08:41:23.776591Z","submitted_at":"2025-05-14T21:50:46Z","title":"Adversarial Attack on Large Language Models using Exponentiated Gradient Descent","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-15T21:29:16.383905Z"},"links":{"citing_paper":"/paper/2505.09820"},"observation_digest":"sha256:ebd36c876113e1da35f0570f6cb80aeac01ef93b4966ff370a3c1db33ae69b1a","observation_id":"a3780aa4-ae9c-4d04-abca-1657f0f21b7c","resolution":{"observed_at":"2026-08-15T21:29:16.383905Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2010.15980","last_updated":"2020-11-07T05:33:35Z","snapshot_observed_at":"2026-08-16T19:09:26.533311Z","submitted_at":"2020-10-29T22:54:00Z","title":"AutoPrompt: Eliciting Knowledge from Language Models with Automatically Generated Prompts","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2010.15980","snapshot_observed_at":"2026-08-15T21:29:16.388004Z","title":"Auto- prompt: Eliciting knowledge from language models with automatically generated prompts,","venue":null,"work_id":null,"year":2010},"citing_paper":{"arxiv_id":"2505.09820","last_updated":"2025-05-14T21:50:46Z","snapshot_observed_at":"2026-08-17T08:41:23.776591Z","submitted_at":"2025-05-14T21:50:46Z","title":"Adversarial Attack on Large Language Models using Exponentiated Gradient Descent","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-15T21:29:16.388004Z"},"links":{"cited_paper":"/paper/2010.15980","citing_paper":"/paper/2505.09820"},"observation_digest":"sha256:498e1f9417328e8977feac7dca2474015eb1141d2670d96168eb2c40dc28c8c0","observation_id":"14ce5075-4c6a-4b89-9a50-1b37925fadcc","resolution":{"observed_at":"2026-08-15T21:29:16.388004Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T21:29:16.392502Z","title":"Hard prompts made easy: Gradient-based discrete optimization for prompt tuning and discovery,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.09820","last_updated":"2025-05-14T21:50:46Z","snapshot_observed_at":"2026-08-17T08:41:23.776591Z","submitted_at":"2025-05-14T21:50:46Z","title":"Adversarial Attack on Large Language Models using Exponentiated Gradient Descent","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-15T21:29:16.392502Z"},"links":{"citing_paper":"/paper/2505.09820"},"observation_digest":"sha256:e3f36eeef3b05a161efab8e15e19dbda29f40701da2cada20365b989203199f9","observation_id":"654f7344-1368-4768-aae3-8abf3f74544f","resolution":{"observed_at":"2026-08-15T21:29:16.392502Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T21:29:16.396800Z","title":"Are aligned neural networks adversarially aligned?","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.09820","last_updated":"2025-05-14T21:50:46Z","snapshot_observed_at":"2026-08-17T08:41:23.776591Z","submitted_at":"2025-05-14T21:50:46Z","title":"Adversarial Attack on Large Language Models using Exponentiated Gradient Descent","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-15T21:29:16.396800Z"},"links":{"citing_paper":"/paper/2505.09820"},"observation_digest":"sha256:206849e2fbb11fbebda665cb5b89851d76415c28c25d7bf3087315989864d0cb","observation_id":"06702131-5177-4386-bec7-c3ef6dc06e96","resolution":{"observed_at":"2026-08-15T21:29:16.396800Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2310.06987","last_updated":"2023-10-10T20:15:54Z","snapshot_observed_at":"2026-08-15T18:47:46.763989Z","submitted_at":"2023-10-10T20:15:54Z","title":"Catastrophic Jailbreak of Open-source LLMs via Exploiting Generation","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2310.06987","snapshot_observed_at":"2026-08-15T21:29:16.400855Z","title":"Catastrophic jailbreak of open-source llms via exploiting generation,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.09820","last_updated":"2025-05-14T21:50:46Z","snapshot_observed_at":"2026-08-17T08:41:23.776591Z","submitted_at":"2025-05-14T21:50:46Z","title":"Adversarial Attack on Large Language Models using Exponentiated Gradient Descent","version":1},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-15T21:29:16.400855Z"},"links":{"cited_paper":"/paper/2310.06987","citing_paper":"/paper/2505.09820"},"observation_digest":"sha256:9ef8f24250725f13bd141dee34f6e1798a52b9ba46b74341fa76619f82e6730e","observation_id":"01f0e7e2-5dc8-4218-ab0d-752c9ffe1e46","resolution":{"observed_at":"2026-08-15T21:29:16.400855Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2307.15043","last_updated":"2023-12-20T20:48:57Z","snapshot_observed_at":"2026-08-12T09:06:50.363435Z","submitted_at":"2023-07-27T17:49:12Z","title":"Universal and Transferable Adversarial Attacks on Aligned Language Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2307.15043","snapshot_observed_at":"2026-08-15T21:29:16.405196Z","title":"Universal and transferable adversarial attacks on aligned language models,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.09820","last_updated":"2025-05-14T21:50:46Z","snapshot_observed_at":"2026-08-17T08:41:23.776591Z","submitted_at":"2025-05-14T21:50:46Z","title":"Adversarial Attack on Large Language Models using Exponentiated Gradient Descent","version":1},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-15T21:29:16.405196Z"},"links":{"cited_paper":"/paper/2307.15043","citing_paper":"/paper/2505.09820"},"observation_digest":"sha256:5dd45d4519d68ce6f75ad6595b36273b32bfd69bce121eef3f21acf8fd436529","observation_id":"bff6df8c-b177-4d6e-9e59-ec97cd3131be","resolution":{"observed_at":"2026-08-15T21:29:16.405196Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2402.15570","last_updated":"2024-02-23T19:12:53Z","snapshot_observed_at":"2026-08-16T14:15:48.297123Z","submitted_at":"2024-02-23T19:12:53Z","title":"Fast Adversarial Attacks on Language Models In One GPU Minute","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.15570","snapshot_observed_at":"2026-08-15T21:29:16.409643Z","title":"Fast adversarial attacks on language models in one gpu minute,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.09820","last_updated":"2025-05-14T21:50:46Z","snapshot_observed_at":"2026-08-17T08:41:23.776591Z","submitted_at":"2025-05-14T21:50:46Z","title":"Adversarial Attack on Large Language Models using Exponentiated Gradient Descent","version":1},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-15T21:29:16.409643Z"},"links":{"cited_paper":"/paper/2402.15570","citing_paper":"/paper/2505.09820"},"observation_digest":"sha256:49918254013c33c3c45983e09c65e5702ded881a4a9826d8b3469e5d6e3fb1af","observation_id":"d4da211b-6020-46bf-817d-97544570e12e","resolution":{"observed_at":"2026-08-15T21:29:16.409643Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T21:29:17.301889Z","title":"Attacking large language models with projected gradient descent,","venue":null,"work_id":"095a43cf-cef8-4722-a39b-94d432a8e64a","year":2024},"citing_paper":{"arxiv_id":"2505.09820","last_updated":"2025-05-14T21:50:46Z","snapshot_observed_at":"2026-08-17T08:41:23.776591Z","submitted_at":"2025-05-14T21:50:46Z","title":"Adversarial Attack on Large Language Models using Exponentiated Gradient Descent","version":1},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-15T21:29:16.414279Z"},"links":{"citing_paper":"/paper/2505.09820"},"observation_digest":"sha256:a51e8369683d99d89a522d5e60585dd26e7bf52a995218fd14b4f4d39eabe93d","observation_id":"84ad1fc4-de68-4e33-9fb0-16b1bd0f29a7","resolution":{"observed_at":"2026-08-15T21:29:17.307932Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2402.09063","last_updated":"2025-04-16T15:15:56Z","snapshot_observed_at":"2026-08-19T03:17:45.396518Z","submitted_at":"2024-02-14T10:20:03Z","title":"Soft Prompt Threats: Attacking Safety Alignment and Unlearning in Open-Source LLMs through the Embedding Space","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.09063","snapshot_observed_at":"2026-08-15T21:29:16.418332Z","title":"Soft prompt threats: Attacking safety alignment and unlearning in open-source llms through the embedding space,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.09820","last_updated":"2025-05-14T21:50:46Z","snapshot_observed_at":"2026-08-17T08:41:23.776591Z","submitted_at":"2025-05-14T21:50:46Z","title":"Adversarial Attack on Large Language Models using Exponentiated Gradient Descent","version":1},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-15T21:29:16.418332Z"},"links":{"cited_paper":"/paper/2402.09063","citing_paper":"/paper/2505.09820"},"observation_digest":"sha256:9fdadcc0880436eea934f37c1b7bdfa0ec7099ec9bd13632e772ae993f156748","observation_id":"28be6349-f425-497c-ad24-49d4f9380f25","resolution":{"observed_at":"2026-08-15T21:29:16.418332Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T21:29:16.423122Z","title":"Jailbreak in pieces: Compositional adversarial attacks on multi-modal language models,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.09820","last_updated":"2025-05-14T21:50:46Z","snapshot_observed_at":"2026-08-17T08:41:23.776591Z","submitted_at":"2025-05-14T21:50:46Z","title":"Adversarial Attack on Large Language Models using Exponentiated Gradient Descent","version":1},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-08-15T21:29:16.423122Z"},"links":{"citing_paper":"/paper/2505.09820"},"observation_digest":"sha256:80737e2c63baf589a0d93edbd56faf7258b69991cbbead9d799b30c13b257087","observation_id":"8674ed51-c1f0-4cee-837e-addf1442e3b4","resolution":{"observed_at":"2026-08-15T21:29:16.423122Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2405.02764","last_updated":"2024-09-12T22:18:03Z","snapshot_observed_at":"2026-08-19T03:17:45.919059Z","submitted_at":"2024-05-04T22:00:28Z","title":"Assessing Adversarial Robustness of Large Language Models: An Empirical Study","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2405.02764","snapshot_observed_at":"2026-08-15T21:29:16.427888Z","title":"Assessing adversarial robustness of large language models: An empirical study,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.09820","last_updated":"2025-05-14T21:50:46Z","snapshot_observed_at":"2026-08-17T08:41:23.776591Z","submitted_at":"2025-05-14T21:50:46Z","title":"Adversarial Attack on Large Language Models using Exponentiated Gradient Descent","version":1},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-08-15T21:29:16.427888Z"},"links":{"cited_paper":"/paper/2405.02764","citing_paper":"/paper/2505.09820"},"observation_digest":"sha256:2ec96a722f6045c04453c02f6eaf68b5cdab159efce2c9a685c8f45c70890e9f","observation_id":"45d0c3f6-4a6f-4b91-98f9-a86b9c764ba6","resolution":{"observed_at":"2026-08-15T21:29:16.427888Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T21:29:17.278603Z","title":"Geometric analysis and metric learning of instruction embeddings,","venue":null,"work_id":"38c456df-7a8a-4768-af3f-cfbe1e5b9b1f","year":2022},"citing_paper":{"arxiv_id":"2505.09820","last_updated":"2025-05-14T21:50:46Z","snapshot_observed_at":"2026-08-17T08:41:23.776591Z","submitted_at":"2025-05-14T21:50:46Z","title":"Adversarial Attack on Large Language Models using Exponentiated Gradient Descent","version":1},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-08-15T21:29:16.432783Z"},"links":{"citing_paper":"/paper/2505.09820"},"observation_digest":"sha256:234e2c176c7d830f482e28c0dea7aa24fdbbdb2067070aa57c119f2e44619d55","observation_id":"cfe9e1c3-21d3-43a2-a2aa-694cabcdd200","resolution":{"observed_at":"2026-08-15T21:29:17.283105Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2307.07870","last_updated":"2023-11-07T16:28:33Z","snapshot_observed_at":"2026-08-20T15:57:24.409976Z","submitted_at":"2023-07-15T19:04:33Z","title":"Large Language Models as Superpositions of Cultural Perspectives","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2307.07870","snapshot_observed_at":"2026-08-15T21:29:16.437346Z","title":"Large language models as superpositions of cultural perspectives,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.09820","last_updated":"2025-05-14T21:50:46Z","snapshot_observed_at":"2026-08-17T08:41:23.776591Z","submitted_at":"2025-05-14T21:50:46Z","title":"Adversarial Attack on Large Language Models using Exponentiated Gradient Descent","version":1},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-08-15T21:29:16.437346Z"},"links":{"cited_paper":"/paper/2307.07870","citing_paper":"/paper/2505.09820"},"observation_digest":"sha256:d1a451c41f47b562095981002d14891356d685451e8a238f41dced24a9c9388f","observation_id":"03fff507-e944-4e25-a0ce-5f076953e413","resolution":{"observed_at":"2026-08-15T21:29:16.437346Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2307.09288","last_updated":"2023-07-19T17:08:59Z","snapshot_observed_at":"2026-08-07T12:56:43.323460Z","submitted_at":"2023-07-18T14:31:57Z","title":"Llama 2: Open Foundation and Fine-Tuned Chat Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2307.09288","snapshot_observed_at":"2026-08-15T21:29:16.442750Z","title":"Llama 2: Open foundation and fine-tuned chat models,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.09820","last_updated":"2025-05-14T21:50:46Z","snapshot_observed_at":"2026-08-17T08:41:23.776591Z","submitted_at":"2025-05-14T21:50:46Z","title":"Adversarial Attack on Large Language Models using Exponentiated Gradient Descent","version":1},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-08-15T21:29:16.442750Z"},"links":{"cited_paper":"/paper/2307.09288","citing_paper":"/paper/2505.09820"},"observation_digest":"sha256:e1b3a3bbb17227f3bb18602080ff30f99773312ed175d02e086eeaff4986d3d2","observation_id":"6ee496b2-3fb9-4b6c-b248-dafb5a595ebb","resolution":{"observed_at":"2026-08-15T21:29:16.442750Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1908.07125","last_updated":"2021-01-03T19:58:55Z","snapshot_observed_at":"2026-08-21T12:22:11.736132Z","submitted_at":"2019-08-20T01:51:40Z","title":"Universal Adversarial Triggers for Attacking and Analyzing NLP","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1908.07125","snapshot_observed_at":"2026-08-15T21:29:16.448110Z","title":"Universal adversarial triggers for attacking and analyzing nlp,","venue":null,"work_id":null,"year":1908},"citing_paper":{"arxiv_id":"2505.09820","last_updated":"2025-05-14T21:50:46Z","snapshot_observed_at":"2026-08-17T08:41:23.776591Z","submitted_at":"2025-05-14T21:50:46Z","title":"Adversarial Attack on Large Language Models using Exponentiated Gradient Descent","version":1},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-08-15T21:29:16.448110Z"},"links":{"cited_paper":"/paper/1908.07125","citing_paper":"/paper/2505.09820"},"observation_digest":"sha256:974c83c3199e31a7b65557d555a5157282fd5d8ad333e6b7b1fa2f57958720e5","observation_id":"c26ca2eb-4355-42de-acb8-0add32eb973b","resolution":{"observed_at":"2026-08-15T21:29:16.448110Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1712.06751","last_updated":"2018-05-24T16:43:45Z","snapshot_observed_at":"2026-08-16T00:36:28.515339Z","submitted_at":"2017-12-19T02:15:19Z","title":"HotFlip: White-Box Adversarial Examples for Text Classification","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1712.06751","snapshot_observed_at":"2026-08-15T21:29:16.453009Z","title":"Hotflip: White-box adver- sarial examples for text classification,","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2505.09820","last_updated":"2025-05-14T21:50:46Z","snapshot_observed_at":"2026-08-17T08:41:23.776591Z","submitted_at":"2025-05-14T21:50:46Z","title":"Adversarial Attack on Large Language Models using Exponentiated Gradient Descent","version":1},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-08-15T21:29:16.453009Z"},"links":{"cited_paper":"/paper/1712.06751","citing_paper":"/paper/2505.09820"},"observation_digest":"sha256:9fccd1a4eac43c84e1e324a65590d2323234f0c698238414cc6788a4a62898b2","observation_id":"5ecb55fd-450c-412a-8e07-68c412623829","resolution":{"observed_at":"2026-08-15T21:29:16.453009Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2404.07921","last_updated":"2024-11-24T18:03:43Z","snapshot_observed_at":"2026-08-17T21:47:51.183917Z","submitted_at":"2024-04-11T17:05:50Z","title":"AmpleGCG: Learning a Universal and Transferable Generative Model of Adversarial Suffixes for Jailbreaking Both Open and Closed LLMs","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2404.07921","snapshot_observed_at":"2026-08-15T21:29:16.457905Z","title":"Amplegcg: Learning a universal and transferable generative model of adversarial suffixes for jailbreaking both open and closed llms,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.09820","last_updated":"2025-05-14T21:50:46Z","snapshot_observed_at":"2026-08-17T08:41:23.776591Z","submitted_at":"2025-05-14T21:50:46Z","title":"Adversarial Attack on Large Language Models using Exponentiated Gradient Descent","version":1},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-08-15T21:29:16.457905Z"},"links":{"cited_paper":"/paper/2404.07921","citing_paper":"/paper/2505.09820"},"observation_digest":"sha256:c870f72dbb7fa8f410b21ec9ac19f527d26f86d0e0fb460ff0b58f9e572059ef","observation_id":"031b59af-b7c5-40eb-ad2b-de002ad07537","resolution":{"observed_at":"2026-08-15T21:29:16.457905Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1706.06083","last_updated":"2019-09-04T18:53:10Z","snapshot_observed_at":"2026-08-07T14:27:46.872660Z","submitted_at":"2017-06-19T17:53:11Z","title":"Towards Deep Learning Models Resistant to Adversarial Attacks","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1706.06083","snapshot_observed_at":"2026-08-15T21:29:16.462733Z","title":"Towards deep learning models resistant to adversarial attacks,","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2505.09820","last_updated":"2025-05-14T21:50:46Z","snapshot_observed_at":"2026-08-17T08:41:23.776591Z","submitted_at":"2025-05-14T21:50:46Z","title":"Adversarial Attack on Large Language Models using Exponentiated Gradient Descent","version":1},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-08-15T21:29:16.462733Z"},"links":{"cited_paper":"/paper/1706.06083","citing_paper":"/paper/2505.09820"},"observation_digest":"sha256:a87465914afaeb3e46eb1c91a14713768ab19cdfa647d407e0aadbd16ae323b4","observation_id":"d3308ecb-c694-4f5d-8543-3f71de6150ec","resolution":{"observed_at":"2026-08-15T21:29:16.462733Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T21:29:16.467755Z","title":"Efficient projections onto the l 1-ball for learning in high dimensions,","venue":null,"work_id":null,"year":2008},"citing_paper":{"arxiv_id":"2505.09820","last_updated":"2025-05-14T21:50:46Z","snapshot_observed_at":"2026-08-17T08:41:23.776591Z","submitted_at":"2025-05-14T21:50:46Z","title":"Adversarial Attack on Large Language Models using Exponentiated Gradient Descent","version":1},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-08-15T21:29:16.467755Z"},"links":{"citing_paper":"/paper/2505.09820"},"observation_digest":"sha256:ea02cb00e5dacda686ff27d1e3e991a342ac0998f57f4b7cd0bfcf335aa25a48","observation_id":"fdb3f88b-be62-4313-9720-d8d3ec6d2e2b","resolution":{"observed_at":"2026-08-15T21:29:16.467755Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T21:29:17.254951Z","title":"Crafting ad- versarial input sequences for recurrent neural networks,","venue":null,"work_id":"dfbc9ad2-0c6b-4f8e-bf98-5c27daccd9db","year":2016},"citing_paper":{"arxiv_id":"2505.09820","last_updated":"2025-05-14T21:50:46Z","snapshot_observed_at":"2026-08-17T08:41:23.776591Z","submitted_at":"2025-05-14T21:50:46Z","title":"Adversarial Attack on Large Language Models using Exponentiated Gradient Descent","version":1},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-08-15T21:29:16.472832Z"},"links":{"citing_paper":"/paper/2505.09820"},"observation_digest":"sha256:342fcb6e4b78b5996d26da3f56ffd69e1fb643d527eaf6fd7064aef601387017","observation_id":"220e539b-b4b8-4f9a-9de6-08aaac1c4c78","resolution":{"observed_at":"2026-08-15T21:29:17.259076Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T21:29:17.241061Z","title":"Exponentiated gradient versus gradient descent for linear predictors,","venue":null,"work_id":"d36a1378-ae96-4e74-b86c-71bda839eb16","year":1997},"citing_paper":{"arxiv_id":"2505.09820","last_updated":"2025-05-14T21:50:46Z","snapshot_observed_at":"2026-08-17T08:41:23.776591Z","submitted_at":"2025-05-14T21:50:46Z","title":"Adversarial Attack on Large Language Models using Exponentiated Gradient Descent","version":1},"reference_index":36,"source":"pdf_text","source_observed_at":"2026-08-15T21:29:16.478035Z"},"links":{"citing_paper":"/paper/2505.09820"},"observation_digest":"sha256:54318fc0178be9aa5316a52b4cd5e92f9a594d8acabb47e4456d778d2b472aa3","observation_id":"51c67002-a060-4470-90a3-029f7b96093b","resolution":{"observed_at":"2026-08-15T21:29:17.245280Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T21:29:17.225572Z","title":"Exponential gradient with momentum for online portfolio selection,","venue":null,"work_id":"f3f24ce0-698f-47fe-9f21-30d9183678a0","year":2022},"citing_paper":{"arxiv_id":"2505.09820","last_updated":"2025-05-14T21:50:46Z","snapshot_observed_at":"2026-08-17T08:41:23.776591Z","submitted_at":"2025-05-14T21:50:46Z","title":"Adversarial Attack on Large Language Models using Exponentiated Gradient Descent","version":1},"reference_index":37,"source":"pdf_text","source_observed_at":"2026-08-15T21:29:16.482227Z"},"links":{"citing_paper":"/paper/2505.09820"},"observation_digest":"sha256:2124737ddf3a835f422028d31046d6cfed50f023358e74a3016c5829b1dec2f4","observation_id":"1f0ac72d-5457-4369-a5b9-348e98340a84","resolution":{"observed_at":"2026-08-15T21:29:17.230310Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1412.6980","last_updated":"2017-01-30T01:27:54Z","snapshot_observed_at":"2026-08-17T19:26:44.032537Z","submitted_at":"2014-12-22T13:54:29Z","title":"Adam: A Method for Stochastic Optimization","version":9},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1412.6980","snapshot_observed_at":"2026-08-15T21:29:16.486996Z","title":"Adam: A method for stochastic optimization,","venue":null,"work_id":null,"year":2014},"citing_paper":{"arxiv_id":"2505.09820","last_updated":"2025-05-14T21:50:46Z","snapshot_observed_at":"2026-08-17T08:41:23.776591Z","submitted_at":"2025-05-14T21:50:46Z","title":"Adversarial Attack on Large Language Models using Exponentiated Gradient Descent","version":1},"reference_index":38,"source":"pdf_text","source_observed_at":"2026-08-15T21:29:16.486996Z"},"links":{"cited_paper":"/paper/1412.6980","citing_paper":"/paper/2505.09820"},"observation_digest":"sha256:4e6e809d3dff02ba126c5111ce2e602f6f2df5664e1ff79178a3cbdbfc624fcf","observation_id":"eec37898-d42e-4b23-9078-219ed691a07c","resolution":{"observed_at":"2026-08-15T21:29:16.486996Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T21:29:16.491670Z","title":"The relaxation method of finding the common point of convex sets and its application to the solution of problems in convex programming,","venue":null,"work_id":null,"year":1967},"citing_paper":{"arxiv_id":"2505.09820","last_updated":"2025-05-14T21:50:46Z","snapshot_observed_at":"2026-08-17T08:41:23.776591Z","submitted_at":"2025-05-14T21:50:46Z","title":"Adversarial Attack on Large Language Models using Exponentiated Gradient Descent","version":1},"reference_index":39,"source":"pdf_text","source_observed_at":"2026-08-15T21:29:16.491670Z"},"links":{"citing_paper":"/paper/2505.09820"},"observation_digest":"sha256:ad7dfc5cc042877799963654c77ab129a7a4a3a421ad9f1fb1bb198e14c6777b","observation_id":"610f98c6-7859-47c2-b45b-f20c3ab68553","resolution":{"observed_at":"2026-08-15T21:29:16.491670Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T21:29:17.211376Z","title":"Iterative bregman projections for regularized transportation problems,","venue":null,"work_id":"d2bbdfe1-42c4-4a78-a347-f90c22520d47","year":null},"citing_paper":{"arxiv_id":"2505.09820","last_updated":"2025-05-14T21:50:46Z","snapshot_observed_at":"2026-08-17T08:41:23.776591Z","submitted_at":"2025-05-14T21:50:46Z","title":"Adversarial Attack on Large Language Models using Exponentiated Gradient Descent","version":1},"reference_index":40,"source":"pdf_text","source_observed_at":"2026-08-15T21:29:16.496633Z"},"links":{"citing_paper":"/paper/2505.09820"},"observation_digest":"sha256:1192248c512881aba23ed02e137092d0135f2f2d20d9e7517ca14dbe1a7ad6fc","observation_id":"8e0d4897-07a3-4234-aedf-fdab31654c2a","resolution":{"observed_at":"2026-08-15T21:29:17.215871Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T21:29:17.195812Z","title":"An inertial forward-backward algorithm for the minimization of the sum of two nonconvex functions,","venue":null,"work_id":"1b93d745-dad7-4271-b844-aa250f73e587","year":null},"citing_paper":{"arxiv_id":"2505.09820","last_updated":"2025-05-14T21:50:46Z","snapshot_observed_at":"2026-08-17T08:41:23.776591Z","submitted_at":"2025-05-14T21:50:46Z","title":"Adversarial Attack on Large Language Models using Exponentiated Gradient Descent","version":1},"reference_index":41,"source":"pdf_text","source_observed_at":"2026-08-15T21:29:16.506520Z"},"links":{"citing_paper":"/paper/2505.09820"},"observation_digest":"sha256:75df7b63a655d622579f1cb17e3b0decd177332649e378fda01c57326846aba2","observation_id":"6565e7be-3bc6-4dab-8688-02cda61b87ee","resolution":{"observed_at":"2026-08-15T21:29:17.200720Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1803.00567","last_updated":"2020-03-18T09:54:55Z","snapshot_observed_at":"2026-08-14T19:40:34.002536Z","submitted_at":"2018-03-01T18:28:43Z","title":"Computational Optimal Transport","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1803.00567","snapshot_observed_at":"2026-08-15T21:29:16.517082Z","title":"Computational optimal transport,","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2505.09820","last_updated":"2025-05-14T21:50:46Z","snapshot_observed_at":"2026-08-17T08:41:23.776591Z","submitted_at":"2025-05-14T21:50:46Z","title":"Adversarial Attack on Large Language Models using Exponentiated Gradient Descent","version":1},"reference_index":42,"source":"pdf_text","source_observed_at":"2026-08-15T21:29:16.517082Z"},"links":{"cited_paper":"/paper/1803.00567","citing_paper":"/paper/2505.09820"},"observation_digest":"sha256:cd446ad3c2909c8e0e7d776fa5ba550f8246b276f525124e4052cbbc0ca832ef","observation_id":"6bc92a63-76ee-409f-b546-87659bc84cd3","resolution":{"observed_at":"2026-08-15T21:29:16.517082Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1410.0641","last_updated":"2014-10-02T18:52:27Z","snapshot_observed_at":"2026-08-17T03:45:42.690601Z","submitted_at":"2014-10-02T18:52:27Z","title":"An inertial forward-backward algorithm for the minimization of the sum of two nonconvex functions","version":1},"cited_work":{"arxiv_id":"1410.0641","doi":null,"metadata_source":"pith","pith_arxiv_id":"1410.0641","snapshot_observed_at":"2026-08-15T21:29:16.721485Z","title":"An inertial forward-backward algorithm for the minimization of the sum of two nonconvex functions","venue":"math.OC","work_id":"baf3bfe8-a8d0-44b0-82a2-3402bab9bdba","year":2014},"citing_paper":{"arxiv_id":"2505.09820","last_updated":"2025-05-14T21:50:46Z","snapshot_observed_at":"2026-08-17T08:41:23.776591Z","submitted_at":"2025-05-14T21:50:46Z","title":"Adversarial Attack on Large Language Models using Exponentiated Gradient Descent","version":1},"reference_index":43,"source":"pdf_text","source_observed_at":"2026-08-15T21:29:16.511844Z"},"links":{"cited_paper":"/paper/1410.0641","citing_paper":"/paper/2505.09820"},"observation_digest":"sha256:529f3faafd20bd41d1b85362a50e831a8c7bd13000c7061a119a7c340e5b983e","observation_id":"6d20c213-c18d-423d-b8b9-3aa3f4a10790","resolution":{"observed_at":"2026-08-15T21:29:16.727783Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T21:29:17.181385Z","title":"Introducing mpt-7b: A new standard for open-source, commercially usable llms, 2023,","venue":null,"work_id":"b9f6d7fc-21b6-48cc-b44f-ed56f22c2222","year":2023},"citing_paper":{"arxiv_id":"2505.09820","last_updated":"2025-05-14T21:50:46Z","snapshot_observed_at":"2026-08-17T08:41:23.776591Z","submitted_at":"2025-05-14T21:50:46Z","title":"Adversarial Attack on Large Language Models using Exponentiated Gradient Descent","version":1},"reference_index":44,"source":"pdf_text","source_observed_at":"2026-08-15T21:29:16.527859Z"},"links":{"citing_paper":"/paper/2505.09820"},"observation_digest":"sha256:08b1a85c8f5616facb5a4a2ddba39e9d1e5476c21ce8a2620bd22d4a38f0335b","observation_id":"de503318-da62-4e26-a0e7-2beb59d07e89","resolution":{"observed_at":"2026-08-15T21:29:17.186032Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2311.16867","last_updated":"2023-11-29T19:45:10Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2023-11-28T15:12:47Z","title":"The Falcon Series of Open Language Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2311.16867","snapshot_observed_at":"2026-08-15T21:29:16.522098Z","title":"The falcon series of open language models,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.09820","last_updated":"2025-05-14T21:50:46Z","snapshot_observed_at":"2026-08-17T08:41:23.776591Z","submitted_at":"2025-05-14T21:50:46Z","title":"Adversarial Attack on Large Language Models using Exponentiated Gradient Descent","version":1},"reference_index":45,"source":"pdf_text","source_observed_at":"2026-08-15T21:29:16.522098Z"},"links":{"cited_paper":"/paper/2311.16867","citing_paper":"/paper/2505.09820"},"observation_digest":"sha256:4ce2c5cdbaef4624b34d87e3e024b7456ba780d3375573a6dccb983368a534d7","observation_id":"d2537125-b55c-4f03-bf93-4b0d1331be5b","resolution":{"observed_at":"2026-08-15T21:29:16.522098Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T21:29:17.166778Z","title":"Judging llm-as-a-judge with mt-bench and chatbot arena,","venue":null,"work_id":"8f1ff2b9-8d83-4c66-bbaa-b55a286be4d4","year":2024},"citing_paper":{"arxiv_id":"2505.09820","last_updated":"2025-05-14T21:50:46Z","snapshot_observed_at":"2026-08-17T08:41:23.776591Z","submitted_at":"2025-05-14T21:50:46Z","title":"Adversarial Attack on Large Language Models using Exponentiated Gradient Descent","version":1},"reference_index":46,"source":"pdf_text","source_observed_at":"2026-08-15T21:29:16.537377Z"},"links":{"citing_paper":"/paper/2505.09820"},"observation_digest":"sha256:40916c0ecb8ca143e45fc15789a8efcf52c701f138f4c0a4099b4056d83753cb","observation_id":"8dd98fed-e5d9-49b9-b7cc-b97fc133e0e5","resolution":{"observed_at":"2026-08-15T21:29:17.171571Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2310.06825","last_updated":"2023-10-10T17:54:58Z","snapshot_observed_at":"2026-08-17T20:30:34.016254Z","submitted_at":"2023-10-10T17:54:58Z","title":"Mistral 7B","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2310.06825","snapshot_observed_at":"2026-08-15T21:29:16.532209Z","title":"Mistral 7b,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.09820","last_updated":"2025-05-14T21:50:46Z","snapshot_observed_at":"2026-08-17T08:41:23.776591Z","submitted_at":"2025-05-14T21:50:46Z","title":"Adversarial Attack on Large Language Models using Exponentiated Gradient Descent","version":1},"reference_index":47,"source":"pdf_text","source_observed_at":"2026-08-15T21:29:16.532209Z"},"links":{"cited_paper":"/paper/2310.06825","citing_paper":"/paper/2505.09820"},"observation_digest":"sha256:f46abe9ebd4c4ea5a623a51d5afe736bd2670270a12f18203133771fab580a33","observation_id":"7013ffd1-1a30-4f9b-b00a-6f29aeaddb9b","resolution":{"observed_at":"2026-08-15T21:29:16.532209Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2310.12773","last_updated":"2023-10-19T14:22:03Z","snapshot_observed_at":"2026-08-19T01:18:13.975742Z","submitted_at":"2023-10-19T14:22:03Z","title":"Safe RLHF: Safe Reinforcement Learning from Human Feedback","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2310.12773","snapshot_observed_at":"2026-08-15T21:29:16.549212Z","title":"Safe rlhf: Safe reinforcement learning from human feedback,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.09820","last_updated":"2025-05-14T21:50:46Z","snapshot_observed_at":"2026-08-17T08:41:23.776591Z","submitted_at":"2025-05-14T21:50:46Z","title":"Adversarial Attack on Large Language Models using Exponentiated Gradient Descent","version":1},"reference_index":48,"source":"pdf_text","source_observed_at":"2026-08-15T21:29:16.549212Z"},"links":{"cited_paper":"/paper/2310.12773","citing_paper":"/paper/2505.09820"},"observation_digest":"sha256:083e26e4fbcac29805a6e31077cb0d4f9f9255954a039bc67cab85724db2395e","observation_id":"43df6081-4a84-4b9f-ac0b-2cd2f4fabcf6","resolution":{"observed_at":"2026-08-15T21:29:16.549212Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2407.21783","last_updated":"2024-11-23T23:27:33Z","snapshot_observed_at":"2026-08-13T17:20:44.002518Z","submitted_at":"2024-07-31T17:54:27Z","title":"The Llama 3 Herd of Models","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2407.21783","snapshot_observed_at":"2026-08-15T21:29:16.544087Z","title":"The llama 3 herd of models,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.09820","last_updated":"2025-05-14T21:50:46Z","snapshot_observed_at":"2026-08-17T08:41:23.776591Z","submitted_at":"2025-05-14T21:50:46Z","title":"Adversarial Attack on Large Language Models using Exponentiated Gradient Descent","version":1},"reference_index":49,"source":"pdf_text","source_observed_at":"2026-08-15T21:29:16.544087Z"},"links":{"cited_paper":"/paper/2407.21783","citing_paper":"/paper/2505.09820"},"observation_digest":"sha256:396b3179182dd00f6ee53f9876fa87626064f52e6a09eb368cb7380c0cc933e4","observation_id":"86bb26c6-1c16-446a-b6d2-76881b89c8b9","resolution":{"observed_at":"2026-08-15T21:29:16.544087Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2404.01318","last_updated":"2024-10-31T22:26:40Z","snapshot_observed_at":"2026-08-11T16:28:21.917686Z","submitted_at":"2024-03-28T02:44:02Z","title":"JailbreakBench: An Open Robustness Benchmark for Jailbreaking Large Language Models","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2404.01318","snapshot_observed_at":"2026-08-15T21:29:16.560280Z","title":"Jailbreakbench: An open robustness benchmark for jailbreaking large language models,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.09820","last_updated":"2025-05-14T21:50:46Z","snapshot_observed_at":"2026-08-17T08:41:23.776591Z","submitted_at":"2025-05-14T21:50:46Z","title":"Adversarial Attack on Large Language Models using Exponentiated Gradient Descent","version":1},"reference_index":50,"source":"pdf_text","source_observed_at":"2026-08-15T21:29:16.560280Z"},"links":{"cited_paper":"/paper/2404.01318","citing_paper":"/paper/2505.09820"},"observation_digest":"sha256:6f003096339417358330c2c8535d306a400cb9da24ba952c38d1ae905dc000ff","observation_id":"af923638-4bb1-4dd4-8a51-57cccc6e8d7f","resolution":{"observed_at":"2026-08-15T21:29:16.560280Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2402.04249","last_updated":"2024-02-27T04:43:08Z","snapshot_observed_at":"2026-08-16T09:07:20.265665Z","submitted_at":"2024-02-06T18:59:08Z","title":"HarmBench: A Standardized Evaluation Framework for Automated Red Teaming and Robust Refusal","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.04249","snapshot_observed_at":"2026-08-15T21:29:16.555115Z","title":"Harmbench: A standardized evaluation framework for automated red teaming and robust refusal,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.09820","last_updated":"2025-05-14T21:50:46Z","snapshot_observed_at":"2026-08-17T08:41:23.776591Z","submitted_at":"2025-05-14T21:50:46Z","title":"Adversarial Attack on Large Language Models using Exponentiated Gradient Descent","version":1},"reference_index":51,"source":"pdf_text","source_observed_at":"2026-08-15T21:29:16.555115Z"},"links":{"cited_paper":"/paper/2402.04249","citing_paper":"/paper/2505.09820"},"observation_digest":"sha256:5c0664fc7517f6aaa7cbcac846ba82b10c3fa30080f9a6627eea9102c592a41b","observation_id":"514f4c1d-22c2-4815-8c9f-08c0818c727f","resolution":{"observed_at":"2026-08-15T21:29:16.555115Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2410.19160","last_updated":"2024-10-24T21:01:45Z","snapshot_observed_at":"2026-08-19T03:17:39.830069Z","submitted_at":"2024-10-24T21:01:45Z","title":"Adversarial Attacks on Large Language Models Using Regularized Relaxation","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2410.19160","snapshot_observed_at":"2026-08-15T21:29:16.565174Z","title":"Adversarial attacks on large language models using regularized relaxation,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.09820","last_updated":"2025-05-14T21:50:46Z","snapshot_observed_at":"2026-08-17T08:41:23.776591Z","submitted_at":"2025-05-14T21:50:46Z","title":"Adversarial Attack on Large Language Models using Exponentiated Gradient Descent","version":1},"reference_index":53,"source":"pdf_text","source_observed_at":"2026-08-15T21:29:16.565174Z"},"links":{"cited_paper":"/paper/2410.19160","citing_paper":"/paper/2505.09820"},"observation_digest":"sha256:13c6df6f9eeec5b65f8231f1bb52184a08a480bb80f1d396d5d4ffdde06a1a4a","observation_id":"2717cc57-55ef-4152-8970-3dcd38bde6d9","resolution":{"observed_at":"2026-08-15T21:29:16.565174Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1412.5154","last_updated":"2014-12-16T20:27:36Z","snapshot_observed_at":"2026-08-18T20:06:27.908968Z","submitted_at":"2014-12-16T20:27:36Z","title":"Iterative Bregman Projections for Regularized Transportation Problems","version":1},"cited_work":{"arxiv_id":"1412.5154","doi":null,"metadata_source":"pith","pith_arxiv_id":"1412.5154","snapshot_observed_at":"2026-08-15T21:29:16.743269Z","title":"Iterative Bregman Projections for Regularized Transportation Problems","venue":"math.NA","work_id":"2ba31d64-cfb3-4866-8592-c92b53d48916","year":2014},"citing_paper":{"arxiv_id":"2505.09820","last_updated":"2025-05-14T21:50:46Z","snapshot_observed_at":"2026-08-17T08:41:23.776591Z","submitted_at":"2025-05-14T21:50:46Z","title":"Adversarial Attack on Large Language Models using Exponentiated Gradient Descent","version":1},"reference_index":2014,"source":"pdf_text","source_observed_at":"2026-08-15T21:29:16.501185Z"},"links":{"cited_paper":"/paper/1412.5154","citing_paper":"/paper/2505.09820"},"observation_digest":"sha256:3d8cccfa19b8a0be9cdea37f99a5f1f2f9cc4b201d96a17491d9023ebb94e8e1","observation_id":"e64fdc34-cb90-4957-ab86-426938272978","resolution":{"observed_at":"2026-08-15T21:29:16.747727Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}}],"paper":{"arxiv_id":"2505.09820","last_updated":"2025-05-14T21:50:46Z","latest_version":1,"primary_category":"cs.LG","snapshot_observed_at":"2026-08-17T08:41:23.776591Z","submitted_at":"2025-05-14T21:50:46Z","title":"Adversarial Attack on Large Language Models using Exponentiated Gradient Descent"},"reference_resolution":{"displayed":53,"state_counts":{"malformed_identifier":0,"metadata_mismatch":2,"parse_uncertain":0,"unresolved":39,"verified_exact":0,"verified_fuzzy":12},"total_outbound_references":53},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"thesis":"As of 23 August 2026, this Paper Citation Record lists 53 of 53 outbound references and 0 inbound Pith citation observations for arXiv:2505.09820."}