{"as_of":"2026-08-14T18:04:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:0d63ee789852e82c5af036de7e1a8faf16e72088bd664cd90db1c319905b74fb","coverage":[{"denominator":37,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":37,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-06T05:53:58.417889Z","state":"measured"},{"denominator":37,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":37,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-14T06:32:32.682623+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2508.01198/citation-record","integrity":"/paper/2508.01198/integrity","json":"/paper/2508.01198/citation-record.json","paper":"/paper/2508.01198"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T05:53:58.793989Z","title":"Direct preference optimization with an offset, 2024","venue":null,"work_id":"ca36f64a-5923-47a4-86b1-20108a0dd56c","year":2024},"citing_paper":{"arxiv_id":"2508.01198","last_updated":"2025-08-02T05:09:58Z","snapshot_observed_at":"2026-08-06T23:52:12.537659Z","submitted_at":"2025-08-02T05:09:58Z","title":"Adaptive Content Restriction for Large Language Models via Suffix Optimization","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-06T05:53:58.305030Z"},"links":{"citing_paper":"/paper/2508.01198"},"observation_digest":"sha256:e54d5cab29ec73262637e4c2a7cbbb52226e59a5452cc9df7958fe5a20122aa4","observation_id":"a255568e-cf6a-4e79-aa19-71d017ef05a6","resolution":{"observed_at":"2026-08-06T05:53:58.797166Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T05:53:58.784290Z","title":"Managing extreme ai risks amid rapid progress","venue":null,"work_id":"4352f194-b55f-4e84-8dba-355f57a9768f","year":2024},"citing_paper":{"arxiv_id":"2508.01198","last_updated":"2025-08-02T05:09:58Z","snapshot_observed_at":"2026-08-06T23:52:12.537659Z","submitted_at":"2025-08-02T05:09:58Z","title":"Adaptive Content Restriction for Large Language Models via Suffix Optimization","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-06T05:53:58.308448Z"},"links":{"citing_paper":"/paper/2508.01198"},"observation_digest":"sha256:de264777f36abe8e2f40b99e835a2d6e99874fb444d95e8389c72c6a6c7cf615","observation_id":"62b9005d-2f1c-4fcb-9db7-95c0668ba337","resolution":{"observed_at":"2026-08-06T05:53:58.787466Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2407.12784","last_updated":"2024-07-17T17:59:47Z","snapshot_observed_at":"2026-08-12T23:20:07.101645Z","submitted_at":"2024-07-17T17:59:47Z","title":"AgentPoison: Red-teaming LLM Agents via Poisoning Memory or Knowledge Bases","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2407.12784","snapshot_observed_at":"2026-08-06T05:53:58.311875Z","title":"Agentpoison: Red-teaming llm agents via poisoning memory or knowledge bases","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2508.01198","last_updated":"2025-08-02T05:09:58Z","snapshot_observed_at":"2026-08-06T23:52:12.537659Z","submitted_at":"2025-08-02T05:09:58Z","title":"Adaptive Content Restriction for Large Language Models via Suffix Optimization","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-06T05:53:58.311875Z"},"links":{"cited_paper":"/paper/2407.12784","citing_paper":"/paper/2508.01198"},"observation_digest":"sha256:0f497c18e0ac90ab66df9b7c851d29bb4411a0726d8ca74ea1487c6f6307fe56","observation_id":"0eeb9873-0e1e-404a-9666-4243f9eb9691","resolution":{"observed_at":"2026-08-06T05:53:58.311875Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T05:53:58.774395Z","title":"Black-box prompt optimization: Aligning large language models without model training","venue":null,"work_id":"097b3c55-bc46-4340-a022-1fe96e36ba18","year":2024},"citing_paper":{"arxiv_id":"2508.01198","last_updated":"2025-08-02T05:09:58Z","snapshot_observed_at":"2026-08-06T23:52:12.537659Z","submitted_at":"2025-08-02T05:09:58Z","title":"Adaptive Content Restriction for Large Language Models via Suffix Optimization","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-06T05:53:58.315974Z"},"links":{"citing_paper":"/paper/2508.01198"},"observation_digest":"sha256:ee18377ecd5cf07483376d181db80d46c6a2843bcd5fa7a25efa3c339275cffa","observation_id":"c025a266-c4b8-4e46-9cbe-575c4eb1ba90","resolution":{"observed_at":"2026-08-06T05:53:58.777727Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T05:53:58.319078Z","title":"Gonzalez, and Ion Stoica","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2508.01198","last_updated":"2025-08-02T05:09:58Z","snapshot_observed_at":"2026-08-06T23:52:12.537659Z","submitted_at":"2025-08-02T05:09:58Z","title":"Adaptive Content Restriction for Large Language Models via Suffix Optimization","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-06T05:53:58.319078Z"},"links":{"citing_paper":"/paper/2508.01198"},"observation_digest":"sha256:b2a0857814fc283e0a8b1253b06281cb5cb155287528a2ddb42d01f615764bda","observation_id":"9fb134b9-b77c-4b99-88a6-ed8a71b8e4ee","resolution":{"observed_at":"2026-08-06T05:53:58.319078Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T05:53:58.757469Z","title":"Personalized autonomous driving with large language models: Field experiments, 2024","venue":null,"work_id":"efbaaab9-dea3-4b01-a650-535bf64b9784","year":2024},"citing_paper":{"arxiv_id":"2508.01198","last_updated":"2025-08-02T05:09:58Z","snapshot_observed_at":"2026-08-06T23:52:12.537659Z","submitted_at":"2025-08-02T05:09:58Z","title":"Adaptive Content Restriction for Large Language Models via Suffix Optimization","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-06T05:53:58.322082Z"},"links":{"citing_paper":"/paper/2508.01198"},"observation_digest":"sha256:3d733a10fca4a5658ba24ac558be7e02aa96cf5738a5654aa1a80ad59d119c18","observation_id":"639f54f8-1dbc-4365-a545-d667e3802223","resolution":{"observed_at":"2026-08-06T05:53:58.761506Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2402.08679","last_updated":"2024-06-07T00:13:08Z","snapshot_observed_at":"2026-08-13T04:19:36.304840Z","submitted_at":"2024-02-13T18:58:48Z","title":"COLD-Attack: Jailbreaking LLMs with Stealthiness and Controllability","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.08679","snapshot_observed_at":"2026-08-06T05:53:58.325167Z","title":"Cold-attack: Jailbreaking llms with stealthiness and controllability","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2508.01198","last_updated":"2025-08-02T05:09:58Z","snapshot_observed_at":"2026-08-06T23:52:12.537659Z","submitted_at":"2025-08-02T05:09:58Z","title":"Adaptive Content Restriction for Large Language Models via Suffix Optimization","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-06T05:53:58.325167Z"},"links":{"cited_paper":"/paper/2402.08679","citing_paper":"/paper/2508.01198"},"observation_digest":"sha256:16bffbf0c748973715598c8a8e9ff2c5b96ead223b9426c9d228fb5fce6dbfab","observation_id":"5d6e4e7d-f0d4-495d-8c1f-029d5b7109fa","resolution":{"observed_at":"2026-08-06T05:53:58.325167Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T05:53:58.328253Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2508.01198","last_updated":"2025-08-02T05:09:58Z","snapshot_observed_at":"2026-08-06T23:52:12.537659Z","submitted_at":"2025-08-02T05:09:58Z","title":"Adaptive Content Restriction for Large Language Models via Suffix Optimization","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-06T05:53:58.328253Z"},"links":{"citing_paper":"/paper/2508.01198"},"observation_digest":"sha256:96b1252c9b02397c90be7c3cd02276f8eba7c1ace9c4716179f90cb96dd5804e","observation_id":"cf874372-5af8-422f-a596-7c4a1de6b09b","resolution":{"observed_at":"2026-08-06T05:53:58.328253Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T05:53:58.330990Z","title":"Llama guard: Llm-based input-output safeguard for human-ai conversations, 2023","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2508.01198","last_updated":"2025-08-02T05:09:58Z","snapshot_observed_at":"2026-08-06T23:52:12.537659Z","submitted_at":"2025-08-02T05:09:58Z","title":"Adaptive Content Restriction for Large Language Models via Suffix Optimization","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-06T05:53:58.330990Z"},"links":{"citing_paper":"/paper/2508.01198"},"observation_digest":"sha256:0002c8145af75a3bae6ff0f2172afc95cde632ce1a97e60b859ac55ad6664a63","observation_id":"caccfccb-4a58-4377-ac01-e21e99f6589f","resolution":{"observed_at":"2026-08-06T05:53:58.330990Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T05:53:58.734563Z","title":"Aligner: Efficient alignment by learning to correct","venue":null,"work_id":"6d4eda2a-5c3b-4aac-b0a2-f7fce464b4f9","year":2024},"citing_paper":{"arxiv_id":"2508.01198","last_updated":"2025-08-02T05:09:58Z","snapshot_observed_at":"2026-08-06T23:52:12.537659Z","submitted_at":"2025-08-02T05:09:58Z","title":"Adaptive Content Restriction for Large Language Models via Suffix Optimization","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-06T05:53:58.333693Z"},"links":{"citing_paper":"/paper/2508.01198"},"observation_digest":"sha256:893db0a952fa094a97202c2ffbe4f079bc0c7e6d6dcfde20637f0f03f51cf27a","observation_id":"254fabb8-4865-4f42-a0c7-3607ceca1b58","resolution":{"observed_at":"2026-08-06T05:53:58.738139Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T05:53:58.336411Z","title":"Beavertails: Towards improved safety alignment of llm via a human-preference dataset","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2508.01198","last_updated":"2025-08-02T05:09:58Z","snapshot_observed_at":"2026-08-06T23:52:12.537659Z","submitted_at":"2025-08-02T05:09:58Z","title":"Adaptive Content Restriction for Large Language Models via Suffix Optimization","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-06T05:53:58.336411Z"},"links":{"citing_paper":"/paper/2508.01198"},"observation_digest":"sha256:3d58d004b1b78ced2f7469513cbfeeed57ce1a920ee98f7ba919a38beb612987","observation_id":"0a5af367-8989-42e0-b95f-f870fd322707","resolution":{"observed_at":"2026-08-06T05:53:58.336411Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T05:53:58.718617Z","title":"ArtPrompt: ASCII art-based jailbreak attacks against aligned LLMs","venue":null,"work_id":"43c8e15f-69fc-4f6b-bb51-a9047c96fb25","year":2024},"citing_paper":{"arxiv_id":"2508.01198","last_updated":"2025-08-02T05:09:58Z","snapshot_observed_at":"2026-08-06T23:52:12.537659Z","submitted_at":"2025-08-02T05:09:58Z","title":"Adaptive Content Restriction for Large Language Models via Suffix Optimization","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-06T05:53:58.339205Z"},"links":{"citing_paper":"/paper/2508.01198"},"observation_digest":"sha256:85d95eca58ca0b74603c2c364569c5cb5adffaff8131b9700e7d0c7a721653f5","observation_id":"6792d18e-31cf-4245-b6b5-a0340d8f1b37","resolution":{"observed_at":"2026-08-06T05:53:58.721738Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T05:53:58.708792Z","title":"Exploiting programmatic behavior of llms: Dual-use through standard security attacks, 2023","venue":null,"work_id":"a6cd7e80-90db-4869-88a3-2ccb1b772a49","year":2023},"citing_paper":{"arxiv_id":"2508.01198","last_updated":"2025-08-02T05:09:58Z","snapshot_observed_at":"2026-08-06T23:52:12.537659Z","submitted_at":"2025-08-02T05:09:58Z","title":"Adaptive Content Restriction for Large Language Models via Suffix Optimization","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-06T05:53:58.341799Z"},"links":{"citing_paper":"/paper/2508.01198"},"observation_digest":"sha256:431a79aa2d38ebac6536f4534d05259b8eaea02d2567823eec0744aa4e6590a6","observation_id":"87cb72c9-fb0f-4dbe-a9a1-faac8235d6d6","resolution":{"observed_at":"2026-08-06T05:53:58.711980Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T05:53:58.698950Z","title":"Tran, Yi Tay, Jeffrey Sorensen, Jai Gupta, Donald Metzler, and Lucy Vasserman","venue":null,"work_id":"14fc1c82-4252-44e2-8d00-4cf3e280e6a4","year":2022},"citing_paper":{"arxiv_id":"2508.01198","last_updated":"2025-08-02T05:09:58Z","snapshot_observed_at":"2026-08-06T23:52:12.537659Z","submitted_at":"2025-08-02T05:09:58Z","title":"Adaptive Content Restriction for Large Language Models via Suffix Optimization","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-06T05:53:58.345658Z"},"links":{"citing_paper":"/paper/2508.01198"},"observation_digest":"sha256:e31efd9be83413adfd5e6618a77e94053a8e0764e78bf5596cd0a7371add3626","observation_id":"01a0837a-e468-409e-83fc-ca99f24c7a0e","resolution":{"observed_at":"2026-08-06T05:53:58.702312Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T05:53:58.348385Z","title":"The power of scale for parameter-efficient prompt tuning","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2508.01198","last_updated":"2025-08-02T05:09:58Z","snapshot_observed_at":"2026-08-06T23:52:12.537659Z","submitted_at":"2025-08-02T05:09:58Z","title":"Adaptive Content Restriction for Large Language Models via Suffix Optimization","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-06T05:53:58.348385Z"},"links":{"citing_paper":"/paper/2508.01198"},"observation_digest":"sha256:003cfe0dc86043ab1e798d22a01ee87c82b1a5e3869c1988b6857bd677fc78a2","observation_id":"78b0344c-e9fa-474c-9c88-07f9107360b9","resolution":{"observed_at":"2026-08-06T05:53:58.348385Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2101.00190","last_updated":"2021-01-01T08:00:36Z","snapshot_observed_at":"2026-08-12T12:37:28.207761Z","submitted_at":"2021-01-01T08:00:36Z","title":"Prefix-Tuning: Optimizing Continuous Prompts for Generation","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2101.00190","snapshot_observed_at":"2026-08-06T05:53:58.351106Z","title":"Prefix-tuning: Optimizing continuous prompts for generation","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2508.01198","last_updated":"2025-08-02T05:09:58Z","snapshot_observed_at":"2026-08-06T23:52:12.537659Z","submitted_at":"2025-08-02T05:09:58Z","title":"Adaptive Content Restriction for Large Language Models via Suffix Optimization","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-06T05:53:58.351106Z"},"links":{"cited_paper":"/paper/2101.00190","citing_paper":"/paper/2508.01198"},"observation_digest":"sha256:f85a49effe89edcd2b73f40888b052920f1f634e68b869ee91d2c628fb93ad4f","observation_id":"a9c55de9-1b6b-4ebf-9913-f5c646bc5ade","resolution":{"observed_at":"2026-08-06T05:53:58.351106Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2310.04451","last_updated":"2024-03-20T21:34:56Z","snapshot_observed_at":"2026-08-06T02:57:30.438059Z","submitted_at":"2023-10-03T19:44:37Z","title":"AutoDAN: Generating Stealthy Jailbreak Prompts on Aligned Large Language Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2310.04451","snapshot_observed_at":"2026-08-06T05:53:58.354035Z","title":"Autodan: Generating stealthy jailbreak prompts on aligned large language models","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2508.01198","last_updated":"2025-08-02T05:09:58Z","snapshot_observed_at":"2026-08-06T23:52:12.537659Z","submitted_at":"2025-08-02T05:09:58Z","title":"Adaptive Content Restriction for Large Language Models via Suffix Optimization","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-06T05:53:58.354035Z"},"links":{"cited_paper":"/paper/2310.04451","citing_paper":"/paper/2508.01198"},"observation_digest":"sha256:fdec132a2695f4c8684f531d7e622d0641f02b77f5192c50409b3d80e56a9443","observation_id":"cfd8cfef-ab85-4ee1-a1f6-41f3e54c1b7f","resolution":{"observed_at":"2026-08-06T05:53:58.354035Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T05:53:58.682403Z","title":"Neurologic decoding:(un) supervised neural text generation with predicate logic constraints","venue":null,"work_id":"13b790d7-0d6e-483d-9275-1f2a3f47d78e","year":2021},"citing_paper":{"arxiv_id":"2508.01198","last_updated":"2025-08-02T05:09:58Z","snapshot_observed_at":"2026-08-06T23:52:12.537659Z","submitted_at":"2025-08-02T05:09:58Z","title":"Adaptive Content Restriction for Large Language Models via Suffix Optimization","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-06T05:53:58.357168Z"},"links":{"citing_paper":"/paper/2508.01198"},"observation_digest":"sha256:b9ede5270009377b519ce8c4b94a25c3a6b1af3f796f4a94b6cc2484cde736be","observation_id":"a5009e84-fafd-46a1-8680-1894bd7b229f","resolution":{"observed_at":"2026-08-06T05:53:58.685652Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T05:53:58.672794Z","title":"A holistic approach to undesired content detection in the real world","venue":null,"work_id":"d4328cdf-ae13-4367-ba33-872593f0e34d","year":2023},"citing_paper":{"arxiv_id":"2508.01198","last_updated":"2025-08-02T05:09:58Z","snapshot_observed_at":"2026-08-06T23:52:12.537659Z","submitted_at":"2025-08-02T05:09:58Z","title":"Adaptive Content Restriction for Large Language Models via Suffix Optimization","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-06T05:53:58.359833Z"},"links":{"citing_paper":"/paper/2508.01198"},"observation_digest":"sha256:2c7d5d4588fd8192073c7a6ca6ed32ac06f848350897dd081a316f161dd5502d","observation_id":"93010d6c-be5f-4222-aef2-0e06fd9dd07b","resolution":{"observed_at":"2026-08-06T05:53:58.675865Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T05:53:58.362652Z","title":"Training language models to follow instructions with human feedback","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2508.01198","last_updated":"2025-08-02T05:09:58Z","snapshot_observed_at":"2026-08-06T23:52:12.537659Z","submitted_at":"2025-08-02T05:09:58Z","title":"Adaptive Content Restriction for Large Language Models via Suffix Optimization","version":1},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-06T05:53:58.362652Z"},"links":{"citing_paper":"/paper/2508.01198"},"observation_digest":"sha256:5e33509b60be1df2512c9989791dc9c61164329aab89da6b18a09f01f0abd3b8","observation_id":"15331cf2-aec7-49d7-b018-b974583828ed","resolution":{"observed_at":"2026-08-06T05:53:58.362652Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T05:53:58.365496Z","title":"Direct preference optimization: Your language model is secretly a reward model","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2508.01198","last_updated":"2025-08-02T05:09:58Z","snapshot_observed_at":"2026-08-06T23:52:12.537659Z","submitted_at":"2025-08-02T05:09:58Z","title":"Adaptive Content Restriction for Large Language Models via Suffix Optimization","version":1},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-06T05:53:58.365496Z"},"links":{"citing_paper":"/paper/2508.01198"},"observation_digest":"sha256:956385de46ed762c5abbafe6476bf8646c8a0f47d07fcee8cfff9259147ab1e9","observation_id":"27502ab2-f932-4328-8ac7-d65dcb87c4d9","resolution":{"observed_at":"2026-08-06T05:53:58.365496Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T05:53:58.650575Z","title":"NeMo guardrails: A toolkit for controllable and safe LLM applications with pro- grammable rails","venue":null,"work_id":"c4ca6f83-3885-47ea-a201-d7714ed3da19","year":2023},"citing_paper":{"arxiv_id":"2508.01198","last_updated":"2025-08-02T05:09:58Z","snapshot_observed_at":"2026-08-06T23:52:12.537659Z","submitted_at":"2025-08-02T05:09:58Z","title":"Adaptive Content Restriction for Large Language Models via Suffix Optimization","version":1},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-06T05:53:58.368159Z"},"links":{"citing_paper":"/paper/2508.01198"},"observation_digest":"sha256:8bd6e7d7479cadd602a2a5500e52dbe6b9d35619eed4d1995db99ae41f52b321","observation_id":"914c76dc-d55a-41a1-9654-232a40da11bf","resolution":{"observed_at":"2026-08-06T05:53:58.654017Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T05:53:58.640654Z","title":null,"venue":null,"work_id":"664e8a6b-12e0-464d-ba57-044d7a2d76d9","year":2024},"citing_paper":{"arxiv_id":"2508.01198","last_updated":"2025-08-02T05:09:58Z","snapshot_observed_at":"2026-08-06T23:52:12.537659Z","submitted_at":"2025-08-02T05:09:58Z","title":"Adaptive Content Restriction for Large Language Models via Suffix Optimization","version":1},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-06T05:53:58.370934Z"},"links":{"citing_paper":"/paper/2508.01198"},"observation_digest":"sha256:32575eb86e479341cbf3cef7a1bdafba97b70b749b37d33ddc727f5692ad8846","observation_id":"39e23c56-9a18-4e34-9acb-db5be13c4fb2","resolution":{"observed_at":"2026-08-06T05:53:58.643605Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2010.15980","last_updated":"2020-11-07T05:33:35Z","snapshot_observed_at":"2026-08-13T21:10:43.984813Z","submitted_at":"2020-10-29T22:54:00Z","title":"AutoPrompt: Eliciting Knowledge from Language Models with Automatically Generated Prompts","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2010.15980","snapshot_observed_at":"2026-08-06T05:53:58.373639Z","title":"Auto- prompt: Eliciting knowledge from language models with automatically generated prompts","venue":null,"work_id":null,"year":2010},"citing_paper":{"arxiv_id":"2508.01198","last_updated":"2025-08-02T05:09:58Z","snapshot_observed_at":"2026-08-06T23:52:12.537659Z","submitted_at":"2025-08-02T05:09:58Z","title":"Adaptive Content Restriction for Large Language Models via Suffix Optimization","version":1},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-06T05:53:58.373639Z"},"links":{"cited_paper":"/paper/2010.15980","citing_paper":"/paper/2508.01198"},"observation_digest":"sha256:c21ad1e759128598262f9078b47f245e806c272f579d7e21f0074ce3a8010f86","observation_id":"be8f3312-ae15-445e-abdf-31fbbec7e130","resolution":{"observed_at":"2026-08-06T05:53:58.373639Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T05:53:58.631210Z","title":"Preference ranking optimization for human alignment","venue":null,"work_id":"0b708031-6952-497b-936a-cd45ec8d803f","year":2024},"citing_paper":{"arxiv_id":"2508.01198","last_updated":"2025-08-02T05:09:58Z","snapshot_observed_at":"2026-08-06T23:52:12.537659Z","submitted_at":"2025-08-02T05:09:58Z","title":"Adaptive Content Restriction for Large Language Models via Suffix Optimization","version":1},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-08-06T05:53:58.377035Z"},"links":{"citing_paper":"/paper/2508.01198"},"observation_digest":"sha256:5255e0c255ba292b52b8e59c1e1fb443b58d14e806c2ec5e00b5151f4ae3f6c8","observation_id":"5a144648-f16b-4c44-b81c-018cc7e4d005","resolution":{"observed_at":"2026-08-06T05:53:58.634574Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T05:53:58.620899Z","title":"Towards conversational diagnostic ai, 2024","venue":null,"work_id":"686834e5-17af-4232-b578-f3d6beed3e7b","year":2024},"citing_paper":{"arxiv_id":"2508.01198","last_updated":"2025-08-02T05:09:58Z","snapshot_observed_at":"2026-08-06T23:52:12.537659Z","submitted_at":"2025-08-02T05:09:58Z","title":"Adaptive Content Restriction for Large Language Models via Suffix Optimization","version":1},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-08-06T05:53:58.380138Z"},"links":{"citing_paper":"/paper/2508.01198"},"observation_digest":"sha256:b7462234f7ed3712745a7e4ec8eac5c6f4aadc52ed0d26816600cfa8d81f183e","observation_id":"d231f7a6-788b-4adc-a010-01a6005f35c0","resolution":{"observed_at":"2026-08-06T05:53:58.624249Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T05:53:58.610044Z","title":"Decodingtrust: A comprehensive assess- ment of trustworthiness in gpt models","venue":null,"work_id":"dd78616d-d90c-461b-bf80-35f02ff7a211","year":2023},"citing_paper":{"arxiv_id":"2508.01198","last_updated":"2025-08-02T05:09:58Z","snapshot_observed_at":"2026-08-06T23:52:12.537659Z","submitted_at":"2025-08-02T05:09:58Z","title":"Adaptive Content Restriction for Large Language Models via Suffix Optimization","version":1},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-08-06T05:53:58.383215Z"},"links":{"citing_paper":"/paper/2508.01198"},"observation_digest":"sha256:4508beedd48f9fbceb71f3cc14ac68410b37f6fce96244a838b43f397af1ae1a","observation_id":"20bb6b8e-bbe3-433c-94f0-a9667b2e157e","resolution":{"observed_at":"2026-08-06T05:53:58.613778Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T05:53:58.599321Z","title":"Minilm: Deep self-attention distillation for task-agnostic compression of pre-trained transformers","venue":null,"work_id":"732c5eed-e908-40c3-ae3c-4a0a52ca6406","year":2020},"citing_paper":{"arxiv_id":"2508.01198","last_updated":"2025-08-02T05:09:58Z","snapshot_observed_at":"2026-08-06T23:52:12.537659Z","submitted_at":"2025-08-02T05:09:58Z","title":"Adaptive Content Restriction for Large Language Models via Suffix Optimization","version":1},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-08-06T05:53:58.386459Z"},"links":{"citing_paper":"/paper/2508.01198"},"observation_digest":"sha256:47786211dfe118c736b58fbc618377f141234f63b945aae7cd56e3826e9f983b","observation_id":"744e59a1-0b1c-4bd1-bf20-46afe61aeded","resolution":{"observed_at":"2026-08-06T05:53:58.602734Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T05:53:58.389404Z","title":"Badchain: Backdoor chain-of-thought prompting for large language models","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2508.01198","last_updated":"2025-08-02T05:09:58Z","snapshot_observed_at":"2026-08-06T23:52:12.537659Z","submitted_at":"2025-08-02T05:09:58Z","title":"Adaptive Content Restriction for Large Language Models via Suffix Optimization","version":1},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-08-06T05:53:58.389404Z"},"links":{"citing_paper":"/paper/2508.01198"},"observation_digest":"sha256:79bda72b1d96fa08064eb84e4c206b16f6bc69c1ab2bf38ebbd7798ea0373ab3","observation_id":"ae94e41d-022b-4bb1-83c7-6fda7264aaa4","resolution":{"observed_at":"2026-08-06T05:53:58.389404Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T05:53:58.581383Z","title":"Guardagent: Safeguard llm agents by a guard agent via knowledge-enabled reasoning, 2024","venue":null,"work_id":"2a3eea57-6dd3-4e33-8229-0b2cdac78691","year":2024},"citing_paper":{"arxiv_id":"2508.01198","last_updated":"2025-08-02T05:09:58Z","snapshot_observed_at":"2026-08-06T23:52:12.537659Z","submitted_at":"2025-08-02T05:09:58Z","title":"Adaptive Content Restriction for Large Language Models via Suffix Optimization","version":1},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-08-06T05:53:58.392499Z"},"links":{"citing_paper":"/paper/2508.01198"},"observation_digest":"sha256:0cb4840a40ca85545db4fb0832d814b6d4b8929a3ceed3f71c82961617ec0902","observation_id":"d4a2f988-defa-42d3-9e99-865e089f1270","resolution":{"observed_at":"2026-08-06T05:53:58.584513Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T05:53:58.571805Z","title":"Suchow, and Khaldoun Khashanah","venue":null,"work_id":"7617d54a-818d-4f09-a53e-316700d899e0","year":2023},"citing_paper":{"arxiv_id":"2508.01198","last_updated":"2025-08-02T05:09:58Z","snapshot_observed_at":"2026-08-06T23:52:12.537659Z","submitted_at":"2025-08-02T05:09:58Z","title":"Adaptive Content Restriction for Large Language Models via Suffix Optimization","version":1},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-08-06T05:53:58.395503Z"},"links":{"citing_paper":"/paper/2508.01198"},"observation_digest":"sha256:24b70658f0b09eabc3b6eb6cb3c53d522c335574618fea96e460a4e2c28045bb","observation_id":"1b32f916-a8f3-4514-a979-f29fc49d734b","resolution":{"observed_at":"2026-08-06T05:53:58.574972Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T05:53:58.562047Z","title":"Rigorllm: Resilient guardrails for large language models against undesired content","venue":null,"work_id":"1c9519c8-0fdc-49fb-a4cd-746526525f3e","year":2024},"citing_paper":{"arxiv_id":"2508.01198","last_updated":"2025-08-02T05:09:58Z","snapshot_observed_at":"2026-08-06T23:52:12.537659Z","submitted_at":"2025-08-02T05:09:58Z","title":"Adaptive Content Restriction for Large Language Models via Suffix Optimization","version":1},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-08-06T05:53:58.399046Z"},"links":{"citing_paper":"/paper/2508.01198"},"observation_digest":"sha256:652de67b21be084141b460ad9c4db985e9794f51ea51f9f28b96ec9bff78d4db","observation_id":"d894a568-24f9-4d87-b5b3-f4d28b0364b5","resolution":{"observed_at":"2026-08-06T05:53:58.565194Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2406.07496","last_updated":"2024-06-11T17:32:21Z","snapshot_observed_at":"2026-08-13T02:15:58.634561Z","submitted_at":"2024-06-11T17:32:21Z","title":"TextGrad: Automatic \"Differentiation\" via Text","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2406.07496","snapshot_observed_at":"2026-08-06T05:53:58.403965Z","title":"differentiation","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2508.01198","last_updated":"2025-08-02T05:09:58Z","snapshot_observed_at":"2026-08-06T23:52:12.537659Z","submitted_at":"2025-08-02T05:09:58Z","title":"Adaptive Content Restriction for Large Language Models via Suffix Optimization","version":1},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-08-06T05:53:58.403965Z"},"links":{"cited_paper":"/paper/2406.07496","citing_paper":"/paper/2508.01198"},"observation_digest":"sha256:d296e85cb985f6a633a07fa805e52939ab1a87ee05435a73c2577bd7466fba88","observation_id":"eb4fbc65-fe66-4119-ab06-05984bea6b7d","resolution":{"observed_at":"2026-08-06T05:53:58.403965Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2401.01614","last_updated":"2024-03-12T23:14:33Z","snapshot_observed_at":"2026-08-13T20:16:41.272728Z","submitted_at":"2024-01-03T08:33:09Z","title":"GPT-4V(ision) is a Generalist Web Agent, if Grounded","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2401.01614","snapshot_observed_at":"2026-08-06T05:53:58.407931Z","title":"Gpt-4v(ision) is a generalist web agent, if grounded","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2508.01198","last_updated":"2025-08-02T05:09:58Z","snapshot_observed_at":"2026-08-06T23:52:12.537659Z","submitted_at":"2025-08-02T05:09:58Z","title":"Adaptive Content Restriction for Large Language Models via Suffix Optimization","version":1},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-08-06T05:53:58.407931Z"},"links":{"cited_paper":"/paper/2401.01614","citing_paper":"/paper/2508.01198"},"observation_digest":"sha256:95b3db4e6d7a2777a692e9fd2e76b16e7e05b140f105755965f2be33b7d8fd6f","observation_id":"e35b0b0b-4a3b-473d-8912-ae49feffb892","resolution":{"observed_at":"2026-08-06T05:53:58.407931Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T05:53:58.551134Z","title":"On prompt-driven safeguarding for large language models","venue":null,"work_id":"3e9ca2d0-af87-4289-832f-63c66f080138","year":2024},"citing_paper":{"arxiv_id":"2508.01198","last_updated":"2025-08-02T05:09:58Z","snapshot_observed_at":"2026-08-06T23:52:12.537659Z","submitted_at":"2025-08-02T05:09:58Z","title":"Adaptive Content Restriction for Large Language Models via Suffix Optimization","version":1},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-08-06T05:53:58.411247Z"},"links":{"citing_paper":"/paper/2508.01198"},"observation_digest":"sha256:e6df7776b07ea25386694898de5c4c0e3d86719a418ec0c68822d1a97c1b34da","observation_id":"d4c0f6d5-16e1-4545-bf2b-d7c2395d8a2d","resolution":{"observed_at":"2026-08-06T05:53:58.555455Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T05:53:58.538162Z","title":"Gonzalez, and Ion Stoica","venue":null,"work_id":"7bcc2194-b702-4a45-9e7e-5271d5bb9d94","year":2023},"citing_paper":{"arxiv_id":"2508.01198","last_updated":"2025-08-02T05:09:58Z","snapshot_observed_at":"2026-08-06T23:52:12.537659Z","submitted_at":"2025-08-02T05:09:58Z","title":"Adaptive Content Restriction for Large Language Models via Suffix Optimization","version":1},"reference_index":36,"source":"pdf_text","source_observed_at":"2026-08-06T05:53:58.414752Z"},"links":{"citing_paper":"/paper/2508.01198"},"observation_digest":"sha256:1a2e9db3e9d2b7f65bdbfb4fd93677f5cfc7e1738a2f5b00b6678c0861ebe4f0","observation_id":"65597223-7de1-4090-aef7-0ffb4a93d818","resolution":{"observed_at":"2026-08-06T05:53:58.542931Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2307.15043","last_updated":"2023-12-20T20:48:57Z","snapshot_observed_at":"2026-08-12T09:06:50.363435Z","submitted_at":"2023-07-27T17:49:12Z","title":"Universal and Transferable Adversarial Attacks on Aligned Language Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2307.15043","snapshot_observed_at":"2026-08-06T05:53:58.417889Z","title":"Answer the question in English","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2508.01198","last_updated":"2025-08-02T05:09:58Z","snapshot_observed_at":"2026-08-06T23:52:12.537659Z","submitted_at":"2025-08-02T05:09:58Z","title":"Adaptive Content Restriction for Large Language Models via Suffix Optimization","version":1},"reference_index":37,"source":"pdf_text","source_observed_at":"2026-08-06T05:53:58.417889Z"},"links":{"cited_paper":"/paper/2307.15043","citing_paper":"/paper/2508.01198"},"observation_digest":"sha256:4584fc1f5f930e16a600029900609e029f0e2273c34e1040e1494b432d63d7bf","observation_id":"63eef6ee-9127-41be-a63b-b15d1a0cda18","resolution":{"observed_at":"2026-08-06T05:53:58.417889Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"paper":{"arxiv_id":"2508.01198","last_updated":"2025-08-02T05:09:58Z","latest_version":1,"primary_category":"cs.CL","snapshot_observed_at":"2026-08-06T23:52:12.537659Z","submitted_at":"2025-08-02T05:09:58Z","title":"Adaptive Content Restriction for Large Language Models via Suffix Optimization"},"reference_resolution":{"displayed":37,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":17,"verified_exact":0,"verified_fuzzy":20},"total_outbound_references":37},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"thesis":"As of 14 August 2026, this Paper Citation Record lists 37 of 37 outbound references and 0 inbound Pith citation observations for arXiv:2508.01198."}